2025年9月29日,DeepSeek发布最新模型DeepSeek-V3.2-Exp,引入全新稀疏注意力机制DSA,显著提升长文本处理效率与推理性能。官方同步开源TileLang和CUDA双版本GPU算子,并推出API 5折优惠活动。新模型基于上周发布的V3.1-Terminus改进,在稳定性及工具调用能力上进一步优化,尤其在128K长上下文推理中成本更低。此外,智谱AI的GLM-4.6模型也在开发中,其官网已将GLM-4.5标记为‘上一代旗舰’。国庆期间将迎来一波AI技术更新热潮,开发者可关注相关资源链接获取更多信息。
原文链接
本文链接:https://kx.umi6.com/article/26079.html
转载请注明文章出处
相关推荐
换一换
Claude Mythos让梁文锋决定融资
2026-06-29 17:43:26
DeepSeek深夜更新后自曝:我是V4(?!)
2026-04-08 12:51:42
DeepSeek秘密造芯!专攻推理,一年前已启动,招聘全程不公开
2026-07-08 13:08:19
AI实盘操作,DeepSeek暴赚,Gemini崩盘,网友:专业对口就是不一样
2025-10-20 21:13:47
MAU被豆包反超,Deepseek挤了点牙膏
2025-10-21 15:28:27
北大团队改造DeepSeek注意力,速度快四倍还不丢精度
2026-04-07 00:20:16
Kimi即将完成20亿美元融资 DeepSeek被曝投后估值或达450亿美元
2026-05-06 20:37:20
DeepSeek又更新了 这次梁文锋没放大招
2026-07-31 20:49:56
DeepSeek据悉拟募资最高500亿元人民币
2026-05-08 21:41:39
六大AI模型被扔进加密市场厮杀,DeepSeek暂为交易之王
2025-10-20 18:12:39
大厂抢郭达雅进行时!DeepSeek核心成员还是个“综艺巨佬”
2026-03-22 15:52:37
不是接入DeepSeek,就叫AI制药
2026-01-17 16:35:32
所有实验室都怕字节,所有人都在夸DeepSeek!美国研究员36小时中国AI行
2026-05-08 13:17:18
732 文章
930635 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47