近日,网页编程能力排行榜迎来更新,DeepSeek-R1凭借出色表现超越Claude 4,荣登全球编程能力榜首。尽管Claude Opus 4一直被视为顶级编码模型,但DeepSeek-R1在LiveCodeBench上的优异成绩引发关注。实测显示,DeepSeek-R1能够快速生成多种编程任务代码,例如34秒内完成带有交互功能的太阳系动画程序,以及23秒内生成现代化AGI主题网页代码。然而,其在复杂任务如俄罗斯方块开发中仍存不足,多次运行均出现bug及交互功能缺失问题。尽管如此,DeepSeek-R1因其开源特性及易用性受到国内用户的青睐。此外,DeepSeek-R1还在多个开源模型榜单中名列前茅,MIT许可证加持下,其综合实力不容小觑。值得注意的是,Kimi新模型Kimi-Dev近期以60.4%的成绩刷新代码开源SOTA记录,挑战着现有编程模型的领先地位。
原文链接
本文链接:https://kx.umi6.com/article/20321.html
转载请注明文章出处
相关推荐
换一换
梁文锋不着急
2025-05-30 21:56:33
Manus都点赞的Claude 4,究竟好在哪儿?
2025-05-23 18:10:26
配这种CPU,GPU单卡就能跑满血DeepSeek-R1,至强+ AMX让预填充速度起飞
2025-02-14 16:40:26
网易有道全线AI应用接入DeepSeek-R1
2025-02-06 17:34:52
火遍全球的DeepSeek:科学家是怎么用它的?
2025-02-05 17:14:11
GPT-4.1正式上线ChatGPT,网友辣评:4.1>4.5
2025-05-16 14:34:48
超越DeepSeek?巨头们不敢说的技术暗战
2025-04-30 19:57:31
123页Claude 4行为报告发布:人类干坏事,会被它反手一个举报?!
2025-05-23 17:25:48
最强编码模型Claude 4!7小时不间断写代码,连玩24小时宝可梦,GitHub已选为Copilot底层模型
2025-05-23 09:46:06
DeepSeek,引爆AI手机?
2025-02-07 12:53:26
DeepSeek-R1秘籍轻松迁移,只需原始数据0.3% | 邱锡鹏团队联合出品
2025-02-24 16:26:25
全球最佳编程 AI 模型:Claude Sonnet 4.5 登场,自主写代码超 30 小时、更像“一位同事”
2025-09-30 08:22:36
阿里通义千问推出编程模型Qwen3-Coder-Flash
2025-08-01 09:24:35
720 文章
778037 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30