Kimi新模型Kimi-Dev开源,参数量仅72B却拿下代码开源SOTA。该模型由月之暗面发布,在SWE-bench Verified上的成绩达到60.4%,超越最新DeepSeek-R1及部分闭源模型。
Kimi-Dev基于MIT协议开源,包含权重和代码,甚至有量化版本上线。其核心技术在于结合BugFixer和TestWriter两种角色,通过文件定位与代码编辑实现问题修复和测试编写。研发团队从Qwen 2.5-72B出发,利用1500亿高质量数据进行训练,涵盖数百万GitHub issue和PR提交,并严格净化数据避免过拟合。
强化学习阶段采用结果导向奖励、高效提示集及正向示例强化等策略,显著提升了代码编辑能力。测试中,Kimi-Dev-72B可生成40个补丁候选和测试候选,并展现规模效应。未来,团队计划扩展至更复杂任务并与主流开发工具深度集成。
项目主页:https://moonshotai.github.io/Kimi-Dev/
GitHub:https://github.com/MoonshotAI/Kimi-Dev
HuggingFace:https://huggingface.co/moonshotai/Kimi-Dev-72B
原文链接
本文链接:https://kx.umi6.com/article/20307.html
转载请注明文章出处
相关推荐
换一换
超越GPT-4o!阿里云开源最强代码模型Qwen2.5-Coder
2024-11-13 16:40:09
Kimi超过DeepSeek的新模型被指“套壳”Qwen?到底怎么回事儿
2025-06-18 21:42:36
打破代码大模型训练瓶颈:MicroCoder将算法数据框架训练经验升级
2026-03-30 01:19:37
AI Coding能撑起一个多大的叙事?
2024-11-18 18:30:51
Claude Sonnet4.5来了,Anthropic说自己工程师已不写代码了,这次我信了
2025-09-30 11:26:54
阿里云通义千问 Qwen3-Coder 宣布开源:480B 参数、原生支持 256K 上下文,可与 Claude Sonnet4 媲美
2025-07-23 08:44:56
美国开源AI实验室Arcee表示:中国模型没有危险性 但会威胁美国闭源模型的利润空间
2026-07-23 15:52:51
天立启鸣发布教育AGI白皮书:破解教育“不可能三角”
2026-07-22 12:58:38
WAIC 2026|从纳米抗体到环肽:分子之心30天两度验证AI底层设计力,筑牢生物经济“多模态新基建”
2026-07-19 15:19:10
上海这场大赛有点“野”:让AI自主科研、控核聚变、认甲骨文
2026-07-23 09:36:06
启鸣达人首发《世界模型驱动的教育AGI白皮书》| WAIC 2026
2026-07-20 18:24:55
「仿真派」落地真产线!苏度WAIC首秀,CEO韩铮:99%+成功率
2026-07-20 14:14:07
不换模型,效果提升104%!上海AI Lab让Harness也能自进化了
2026-07-19 15:23:10
753 文章
836909 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30