经过一周激烈的竞争,谷歌新模型Gemini 1.5 Pro(0801)在lmsys竞技场击败了GPT-4o,成为新的冠军。此次胜利不仅是总榜上的第一,也在视觉排行榜上独占鳌头,获得超过1200名匿名投票者的认可。Gemini团队的Simon Tokumine对此表示祝贺,强调这是他们制作的最强大、最聪明的模型。Reddit用户对该模型给予高度评价,希望其功能不受限制。 ChatGPT官方账号暗示,此消息可能预示着OpenAI即将推出新版本进行反击。与此同时,谷歌AI Studio宣布Gemini 1.5 Pro(0801)进入免费测试阶段,引发网友热议。尽管并非全新模型,Gemini 1.5 Pro(0801)在多语言能力基准测试中表现出色,但在编码和特定挑战中仍存在不足。值得注意的是,Gemini 2(2B)也已加入战场,展现出强大的性能,挑战其他模型。然而,竞技场的权威性受到了质疑,因为模型在不同评估标准下的表现差异显著。这场技术竞赛凸显了AI领域的快速进步与持续挑战。
原文链接
本文链接:https://kx.umi6.com/article/4448.html
转载请注明文章出处
相关推荐
换一换
人类打辩论不如GPT-4?!Nature子刊:900人实战演练,AI胜率64.4%,还更会说服人
2025-05-25 15:19:25
GPT-4不是世界模型,LeCun双手赞同,ACL力证LLM永远无法模拟世界
2024-06-17 09:33:33
谁卡了OpenAI的脖子?
2024-07-03 14:32:20
比GPT-4强100倍!OpenAI将在12月发布新模型—猎户座
2024-10-29 11:24:12
万轮实测:GPT-4.5不如GPT-4
2025-02-28 21:30:01
AI可能比你更会炒股?最新研究:GPT-4比人类更擅长金融分析和预测
2024-05-29 14:54:08
重磅消息传来,通过测试了,74年来最高,54%的参与者误认为它是真人
2024-06-21 08:19:03
OpenAI首席技术官:预计几年内“博士级智能”的AI就会出现
2024-06-21 19:34:02
用GPT-4纠错GPT-4!OpenAI推出CriticGPT模型
2024-06-28 14:37:33
新王登基,Gemini 1.5 Pro再度更新,超越GPT 4o和Claude-3.5
2024-09-04 11:37:42
研究称 GPT-4 通过了图灵测试,54% 的人将其误认为真人
2024-06-17 16:16:00
OpenAI 开放 GPT-4o 定制功能,企业可更轻松打造专属 AI 助手
2024-08-21 08:01:20
Ilya参与,OpenAI给GPT-4搞可解释,提取了1600万个特征,还能看它怎么想
2024-06-07 16:37:36
729 文章
806078 浏览
24小时热文
更多
-
2026-07-24 12:36:48 -
2026-07-24 11:35:13 -
2026-07-24 10:33:39