1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

2024年冬天,杭州一家名为“深度求索”的初创公司发布了全新大模型DeepSeek-V3。在多项基准测试中,它的性能超越了其他开源模型,甚至接近顶尖闭源模型GPT-4o。尤其在数学推理上,DeepSeek-V3表现出色。

DeepSeek-V3的研发成本仅为558万美元,远低于GPT-4o的成本。这让美国人感到震惊,反思大模型和算力的投资价值。更重要的是,DeepSeek-V3展示了中国的首创精神,采用了多项开创性技术,如MLA和DeepSeekMoE,提升了模型性能和训练效率。

DeepSeek背后的资方是一家低调的私募基金——幻方量化。该公司在2023年成立“深度求索”子公司,团队仅139人,远少于OpenAI的1200人。梁文峰,幻方量化的创始人,带领这支团队,凭借对AI和数学的深刻理解,创造了DeepSeek-V3。

梁文峰曾研究量化投资,2010年获得成功后转向AI领域。他坚信AI会改变世界,因此在2015年创立幻方量化,致力于打造顶级量化基金。为了支持AI发展,梁文峰大规模布局AI算力,包括“萤火一号”和“萤火二号”。

梁文峰强调,创新不仅仅是商业驱动的,还需要好奇心和创造欲。DeepSeek-V3的成功证明了中国企业在原创技术上的潜力,有望引领AI产业的新方向。

原文链接
本文链接:https://kx.umi6.com/article/11861.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
摩根资产管理:中国科技领域将迎来“更多DeepSeek时刻”
2026-01-14 16:47:01
对欧盟AI法案说“不”!美官员:严厉监管或使科技退步 造成安全漏洞
2024-12-19 18:02:34
梁文锋署名DeepSeek新论文:公开V3大模型降本方法
2025-05-16 13:44:22
欧盟不再只是监管
2025-03-03 19:34:38
奥特曼最新访谈认可“套壳”:多数改变世界的公司,最初都是这样
2025-04-07 16:00:26
大模型性价比之王来了!训练2个月、花费558万美元 性能匹敌GPT-4o
2024-12-27 14:07:00
英伟达的最大空头出现了
2024-12-31 15:46:07
把12个AI凑到一起打工,它们竟然搞起“小团体”?
2025-10-16 22:02:39
梁文锋等发表DeepSeek V3回顾性论文
2025-05-16 17:08:55
TCL中环张雪囡:创新和资本,光伏周期下优胜劣汰的关键因素
2024-12-13 14:26:28
微软大中华区董事长侯阳将出任新一届企业创新创投联盟联席理事长
2024-07-10 17:40:57
DeepSeek-V3首个版本上线
2024-12-27 08:58:12
阿里云 PAI 支持云上一键部署 DeepSeek-V3、DeepSeek-R1 系列模型
2025-02-07 23:07:43
24小时热文
更多
扫一扫体验小程序