12月1日,DeepSeek发布两款新模型——DeepSeek V3.2和DeepSeek-V3.2-Speciale。前者性能与GPT-5相当,后者更在多项基准测试中追平闭源模型天花板Gemini,并在IMO 2025、CMO 2025等竞赛中斩获金牌。此次更新通过稀疏注意力(DSA)优化长文本处理能力,显著降低计算成本,同时强化后训练阶段投入超10%总算力提升模型表现。此外,DeepSeek优化了工具调用逻辑,改进Agent能力,并推出支持深度思考的特殊版本Speciale。尽管其Token消耗量较高,但价格仅为Gemini的1/20,性价比突出。DeepSeek持续以算法创新缩小开源与闭源模型差距,展现技术巧思。
原文链接
本文链接:https://kx.umi6.com/article/29549.html
转载请注明文章出处
相关推荐
换一换
DeepSeek组建Harness团队,非「超能力者」不要?中国AI开启「做产品」的关键一跳
2026-05-21 18:58:24
DeepSeek上线专家模式
2026-04-08 08:44:08
刚刚,DeepSeek V4 Pro正式版发布,多项对标Fable 5
2026-08-13 12:16:47
DeepSeek新论文剧透V4新框架!用闲置网卡加速智能体推理性能
2026-02-27 16:53:38
最强开源大模型除夕登场!397B参数千问3.5超越Gemini 3,百万Tokens低至8毛
2026-02-16 19:34:51
DeepSeek 输入缓存降价
2026-04-26 23:42:34
DeepSeek连更GitHub,华尔街回想起被支配的恐惧:“DeepSeek第二时刻”要来了
2026-02-24 13:45:27
DeepSeek急招Agent方向!一口气放17个岗位,重度Vibe Coding优先
2026-03-25 15:37:07
DeepSeek连更GitHub 华尔街回想起被支配的恐惧
2026-02-24 15:51:36
梁文锋出资200亿!DeepSeek首轮创纪录融资500亿,V4.1定档6月
2026-05-09 11:07:00
AI出海,掘金一个时代
2026-02-07 10:06:40
从 OpenClaw 们自掏腰包补贴,看中国模型又一个全球时刻
2026-02-03 02:12:36
深度解析:DeepSeek不差钱,为什么还要融500亿?
2026-05-09 19:34:13
770 文章
942351 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47