2025年8月21日,DeepSeek在发布DeepSeek-V3.1的官方文章中透露,该版本采用了UE8M0 FP8 Scale参数精度,这一技术专为即将推出的下一代国产芯片设计。此外,DeepSeek-V3.1对分词器及chat template进行了显著优化,与前代DeepSeek-V3相比存在较大差异。这一消息由DeepSeek官微置顶留言确认,显示出其在模型性能和硬件适配上的创新突破。
原文链接
本文链接:https://kx.umi6.com/article/23959.html
转载请注明文章出处
相关推荐
换一换
蚂蚁集团推出两款 MoE 大模型,用国产芯片训练成本显著降低
2025-03-24 16:08:27
首次:国产芯片全程训练,智谱华为合作 GLM-Image 模型登顶 Hugging Face Trending
2026-01-16 09:24:46
消息称蚂蚁集团采用阿里、华为等国产芯片训练 AI:性能匹敌英伟达 H800,成本降低 20%
2025-03-24 15:01:24
DeepSeek-V3.1 正式发布,官方详解迈向 AI Agent 时代的第一步
2025-08-21 15:34:29
国产芯片大战更焦灼了
2024-07-09 15:42:11
Clawdbot国产芯片适配完成!清华特奖出手,开源框架直接一键部署
2026-02-03 13:37:30
百度AI芯片公司冲刺IPO:出货量国产第二
2026-01-03 15:15:25
全采用国产芯片!我国首个万卡级全栈自主可控智算集群点亮
2026-03-30 14:52:17
做难而正确的AI Infra创新——专访国产大模型推理引擎xLLM社区负责人刘童璇
2025-12-02 12:08:01
上交大冷静文:模型发展需要和芯片、系统厂商协同
2025-04-30 20:26:59
实测美团 LongCat:快到极致,但是别说追平 DeepSeek
2025-09-05 15:22:48
深圳“十五五”规划纲要:到2030年全市实时可用算力规模超150EFlops 国产芯片部分指标和算力集群达到国际先进水平
2026-05-26 12:29:28
DeepSeek一句话让国产芯片集体暴涨!背后的UE8M0 FP8到底是个啥
2025-08-22 14:48:58
718 文章
801261 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30