4月15日,科技媒体bleepingcomputer报道,OpenAI最新发布的GPT-4.1系列模型在编程能力上显著提升,其中GPT-4.1的SWE-bench Verified得分达54.6%,远超GPT-4o(21.4%)和GPT-4.5(26.6%)。然而,在与谷歌Gemini系列对比中,GPT-4.1仍显逊色。Stagehand基准数据显示,Gemini 2.0 Flash的错误率为6.67%,精确匹配率达90%,且成本仅为GPT-4.1的十分之一。此外,哈佛大学科学家Pierre Bongrand指出,GPT-4.1的性价比不及Gemini 2.5 Pro及DeepSeek等竞品。在编码专项测试中,GPT-4.1得分52%,而Gemini 2.5以73%的成绩领先。尽管如此,GPT-4.1作为非推理模型,其编码能力仍处于行业顶尖水平。
原文链接
本文链接:https://kx.umi6.com/article/17228.html
转载请注明文章出处
相关推荐
换一换
死敌爆料是狠!OpenAI内部信阴阳Claude营收注水80亿,然后泄露了…
2026-04-15 11:54:00
马斯克死磕奥特曼:赔款我不要,但他必须离开OpenAI董事会
2026-04-09 12:02:49
投资人不买账 OpenAI估值8520亿美元遭质疑:战略转向引发争议
2026-04-15 06:41:58
独家解读|OpenAI 为什么要冒死“脱离群众”?
2026-06-29 14:34:03
Sora之父“跑路”背后的五大真相是什么?
2026-04-30 17:39:21
太抓马了!马斯克OpenAI开庭,硅谷巨富互揭老底像极了村口吵架
2026-05-01 15:34:55
马斯克称OpenAI是自己的创意 现任CEO奥尔特曼是“小偷”
2026-04-29 14:26:51
OpenAI与微软“离婚”了 反目成仇还是好聚好散
2026-04-29 00:47:40
OpenAI计划推出专攻网络安全的新模型
2026-04-09 20:25:55
OpenAI发布20颗HBM内存堆栈的芯片专利
2026-04-23 17:19:48
OpenAI收购了一家脱口秀公司
2026-04-03 18:13:08
OpenAI大神教你如何榨干Codex
2026-05-23 18:54:39
OpenAI计划为ChatGPT广告定价新方案 探讨其他升级方案
2026-04-15 21:24:20
757 文章
826765 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30