标题:英伟达面临强劲对手:DeepSeek-V3
神秘的东方力量再次震惊世界,这次是大模型。12月26日,幻方量化旗下的DeepSeek发布新一代开源大模型DeepSeek-V3,该模型参数量高达671B,仅用2048块GPU训练2个月,总成本557.6万美元。这意味着DeepSeek-V3的训练成本仅为GPT-4o的二十分之一。
在性能方面,DeepSeek-V3在多个任务上表现优异,甚至超越其他开源大模型,与GPT-4o和Claude 3.5 Sonnet相比也毫不逊色。广发证券分析称,DeepSeek-V3的算力成本降低得益于DeepSeekMoE和MLA架构的优化。
DeepSeek不仅是大模型价格战的最早发起者,还提供了史无前例的性价比。在定价上,DeepSeek-V3 API每百万tokens输入费用为0.5元(缓存命中)/2元(缓存未命中),输出费用为8元,性价比较高。
DeepSeek由知名量化私募幻方量化创立,拥有强大的算力储备。幻方量化创始人梁文锋表示,他们致力于推动技术前沿,降低成本,使AI普惠大众。
原文链接
本文链接:https://kx.umi6.com/article/11045.html
转载请注明文章出处
相关推荐
换一换
2025年,AI大模型打响「生态战」
2025-04-22 14:19:14
持续推进创新与突破!界面财联社致力于迈向更主流更国际化金融信息平台
2025-12-22 11:46:38
面壁智能获新一轮数亿元融资,贵州茅台酒旗下基金、国中资本等出资
2025-05-21 10:03:05
走路洗车、红绿色盲等问题都答不对了 网友吐槽最强编程AI降智严重
2026-04-11 14:04:46
豆包斗元宝,开始拼社交
2025-04-22 21:30:31
Anthropic玩砸了 吹嘘的最强AI大模型被限制:非美国人不能用
2026-06-13 11:16:44
小米集团创始人雷军:AI大模型是智能网联汽车的未来趋势
2025-10-16 18:00:06
比亚迪用大模型,刷榜全球最低油耗
2025-10-24 21:53:50
搜狗输入法,居然还在更新??
2026-01-28 09:03:40
从「造砖」到「盖楼」,谁在重新定义AI大模型
2025-06-23 18:27:05
AI大模型实时投资比赛“Alpha Arena”结果出炉:阿里千问Qwen夺冠
2025-11-04 12:13:28
首次披露!DeepSeek V3 发布软硬一体协同训练论文,公开“降成本”秘诀
2025-05-16 14:52:41
DeepSeek对“王一博案”道歉?假新闻!
2025-07-03 23:32:06
848 文章
1038998 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47