1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

谷歌新模型Gemini 1.5 Pro在lmsys竞技场首次夺冠,击败了GPT-4o,成为双冠王,总榜评分高达1300以上,并在视觉排行榜上领先。Gemini团队对此表示庆祝,称此模型为他们制作过的最强大、最聪明的版本。Reddit用户对Gemini 1.5 Pro给予正面评价,期待其功能不被削减。然而,Gemini 1.5 Pro在编码和特定挑战上表现不佳,受到部分网友批评。此外,谷歌推出了Gemini 2系列中的20亿参数模型Gemma 2(2B),并在竞技场排行榜上超越了所有GPT-3.5模型,甚至超越了Mixtral-8x7b。专家们对竞技场的排名权威性提出了质疑,强调MMLU等其他评估方式的重要性。Gemini 1.5 Pro的胜利引发讨论,关于匿名投票排名的可靠性,以及是否应停止使用此类排行榜。

原文链接
本文链接:https://kx.umi6.com/article/4457.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
把 AI 放进《我的世界》服务器:GPT-4o 杀牛宰羊,Claude3.5 把家拆了
2024-10-21 13:29:28
谷歌 AI 聊天机器人 Gemini 月活达 3.5 亿,与 ChatGPT 等竞品仍有差距
2025-04-24 08:28:04
GPT-4o的P图太火了,GPU在融化,官方终于限流了
2025-03-28 21:07:22
零一万物新旗舰模型 Yi-Lightning 发布:LMSYS 测试国产首次超越 GPT-4o,中国第一、世界第六
2024-10-17 09:59:42
国产大模型 DeepSeek-V3 开源:6710 亿参数自研 MoE,性能和 GPT-4o 不分伯仲
2024-12-27 08:55:04
OpenAI 发布最新技术报告,揭秘 GPT-4o 变谄媚的原因
2025-05-03 16:36:59
GPT-4o图像生成今起免费!奥特曼坐镇紧急发布,指令遵循/文本控制表现惊艳
2025-03-26 10:43:57
《GTA6》电臀舞玩法被辟谣:网友瞎编的 结果谷歌AI全信了
2025-10-22 18:52:05
不用开口:谷歌 AI 帮你致电商家,价格、预约一键搞定
2025-01-31 08:47:40
过于追求人性化:奥尔特曼称 GPT-4o 出现“谄媚烦人”倾向,OpenAI 计划在一周内修复
2025-04-28 09:46:16
重新体验GPT-5后,我想它比GPT-4o 更需要一场葬礼
2025-08-11 19:06:36
一手体验:最新发布的GPT-4o多模态生图,就是当今的王
2025-03-26 18:05:08
Cyberklick&谷歌AI应用沙龙:洞察需求,长效增长
2024-08-21 17:04:58
24小时热文
更多
扫一扫体验小程序