DeepSeek公司发布了全新AI模型DeepSeek-V3,仅用2048块H800显卡、耗时两个月便训练出6710亿参数模型,效率比Meta高11倍。DeepSeek-V3采用MoE架构和MLA机制,结合FP8混合精度框架和DualPipe算法,大幅提升了训练效率。这一成就在芯片受限环境下尤为突出,显示了软件创新突破硬件限制的潜力。DeepSeek-V3的成功引发了市场对AI领域‘卖铲人’地位变化的担忧,英伟达股价一度下跌。
原文链接
本文链接:https://kx.umi6.com/article/11196.html
转载请注明文章出处
相关推荐
换一换
马斯克xAI新模型上线,通过“50米外洗车店”测试,回答偏好高度贴合老马本人
2026-02-18 16:31:22
微软推出其首款自研 AI 模型:MAI-Voice-1 秒级生成音频,MAI-1-preview 剑指 Copilot 文本场景
2025-08-29 08:34:31
放开成人内容,OpenAI是为了提升性能?
2025-10-22 17:49:49
摩尔线程携手硅基流动实现DeepSeek-V3大模型高性能推理
2026-01-21 20:31:18
马斯克的最快AI模型来了
2025-09-16 12:09:37
中门对狙,这下真的AI春晚了
2026-02-07 09:59:29
Meta最新AI模型推迟发布 性能表现不如同行
2026-03-13 16:30:15
大厂AI各走「开源」路
2025-10-17 09:09:57
英伟达CEO黄仁勋:未来十年世界上大部分汽车将实现自动驾驶或高度自动驾驶
2026-01-06 15:13:14
亚马逊云科技发布 Nova 2 系列 AI 模型,同步推出 Nova Forge 定制服务
2025-12-03 09:12:53
苹果用上了安卓AI,马斯克为啥急得跳脚?
2026-01-15 11:35:02
马斯克的最强 AI 模型 Grok 4 现已免费开放,非订阅用户每天可限量使用
2025-08-11 10:02:03
OpenAI将全面杀入企业级市场
2026-01-04 16:14:13
755 文章
812926 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30