2月27日,腾讯发布混元新一代快思考模型Turbo S,该模型能实现“秒回”,吐字速度提升一倍,首字时延降低44%。Turbo S在知识、数学、推理等领域效果对标DeepSeek V3、GPT 4o、Claude等模型。该模型采用Hybrid-Mamba-Transformer架构,显著降低计算复杂度和KV-Cache缓存占用,实现成本下降。这是首次将Mamba架构无损应用于超大型MoE模型。Turbo S将成为腾讯混元系列衍生模型的核心基座,未来可为推理、长文、代码等模型提供基础能力。即日起一周内,开发者和企业用户可在腾讯云上免费试用,定价为输入0.8元/百万tokens,输出2元/百万tokens。
原文链接
本文链接:https://kx.umi6.com/article/14479.html
转载请注明文章出处
相关推荐
换一换
DeepSeek V3.1发布后,投资者该思考这四个问题
2025-08-21 09:26:48
MiniMax M1全球技术闭门会实录:RL、混合架构、长上下文的下一步
2025-07-22 13:32:06
IBM 推出 Granite 4.0 系列模型:混合架构降低内存需求,Apache 2.0 开源
2025-10-04 18:04:27
GPT-6曝光 OpenAI总裁说:AGI登场
2026-09-04 17:31:44
刚刚,GPT-6正式发布!OpenAI:欢迎来到AGI时代
2026-09-04 06:01:21
7天长不出头发赔1万元!一洗发水AI广告宣传涉嫌违法被投诉
2026-08-31 07:26:59
AIVC只是前菜!复旦提出生命算子,统一生命建模
2026-09-01 12:33:49
阿里开源 Qwen3.8-27B 本地实测:性能很强,但 Agent 适配仍待补课
2026-09-01 16:55:58
2026 上半年智能眼镜竞争加剧,雷鸟创新五榜登顶实现全品类销量领先
2026-09-04 14:21:28
A社化身A割!Claude官宣永久提额25%,结果到手反而少17%
2026-09-01 16:44:57
千问办公上线首月用户数突破 3000万,企业用户占比过半
2026-09-04 14:20:03
58同城姚劲波:AI转型不能假手他人 企业家必须亲自驾驭AI
2026-09-06 13:58:43
没有全科优秀,具身模型别想进入百万小时
2026-08-31 17:52:44
745 文章
958817 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47