12月16日,月之暗面Kimi发布了视觉思考模型k1,该模型基于强化学习技术,支持端到端图像理解和思维链技术,并在数学、物理、化学等基础科学领域的基准测试中超过OpenAI o1、GPT-4o及Claude 3.5 Sonnet。Kimi新模型已上线最新版“Kimi智能助手”APP及网页版Kimi+页面,用户可通过拍照或上传图片体验完整的推理过程。k1模型的训练分为两阶段,首先通过预训练得到基础模型,然后进行强化学习后训练,其字符识别能力在多项基准测试中表现优异。此外,Kimi模型研发团队自主构建了Science Vista测试集,涵盖不同难度的数理化图片题目,将开放给全行业使用。尽管如此,k1模型在分布外泛化、复杂问题成功率及多轮问答效果等方面仍需改进。
原文链接
本文链接:https://kx.umi6.com/article/10247.html
转载请注明文章出处
相关推荐
换一换
于骞出席德国慕尼黑汽车论坛:世界模型+强化学习是通向物理AI的必经之路
2026-03-19 19:23:06
4o-mini华人领队也离职了,这次不怪小扎
2025-08-19 16:01:05
Kimi即将推出新一代万亿大模型:开源王者刷新 去年已超GPT5
2026-01-20 22:33:50
Kimi发布全新Agent模式OK Computer
2025-09-25 17:11:04
OpenAI路线遭质疑,Meta研究员:根本无法构建超级智能
2025-06-20 21:05:08
新模型上线期间出现功能异常 月之暗面公布补偿方案:全员额度重置
2026-04-22 22:32:08
清华刘洋团队论文:揭示为何 70B 的医疗模型,反而不如 8B 会问诊丨ILCR 2026
2026-02-24 14:48:42
比0.99元羊毛更重要的,是跟AI砍价的快乐
2025-11-12 21:22:24
奖励模型也能Scaling!上海AI Lab突破强化学习短板,提出策略判别学习新范式
2025-07-11 11:34:40
蚂蚁开源 Ring-1T,成就推理、编程、通用智能三冠王
2025-10-24 11:36:00
LLM强化学习新框架!UCSD多智能体训练框架让LLM工具调用能力暴增5.8倍
2025-11-08 13:43:06
1小时真机RL微调成功率破95%!HIL-ResRL:即插即用的VLA“外挂”神器
2026-06-24 18:44:53
字节&MAP重塑大模型推理算法优化重点,强化学习重在高效探索助力LLM提升上限
2025-08-11 10:59:04
778 文章
822278 浏览
24小时热文
更多
-
2026-07-24 16:46:46 -
2026-07-24 15:46:50 -
2026-07-24 15:45:36