1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

国产大模型高考成绩公布,豆包以683分的文科总成绩位列第一,理科648分排名第二。Gemini理科总分655分,排名第一。评测采用山东省高考卷,主科为全国一卷,副科为山东卷,满分750分。测试通过API进行,不联网,评分方式模拟高考,包括机评、人工质检和双评制。豆包在数学、化学、生物等科目表现优异,但在语文写作中因跑题仅得95分。若按赋分规则计算,豆包有望冲刺清华、北大。评测显示,大模型在数学推理能力上显著提升,但图像理解仍存短板,如单选题全军覆没。英语写作略显单调,理综题目中图像理解能力较弱。豆包还参加了印度JEE Advanced考试,表现接近前10名。其性能提升得益于多模态融合、深度思考能力和AutoCoT技术优化,能处理长文本与复杂问题。未来全模态推理或成重要发展方向。

原文链接
本文链接:https://kx.umi6.com/article/20799.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
类Agent能力 字节豆包上线“深入研究”功能
2025-06-30 16:45:57
国家发改委:指导国产大模型加大力度适配国产算力芯片
2026-05-22 11:43:54
字节跳动豆包新版深度思考开启测试
2025-03-28 10:40:39
豆包、千问与Kimi,站在AI Agent的岔路口
2026-01-21 08:59:27
豆包上线“深入研究”功能:快速、全面地处理高难度的复杂任务
2025-06-30 14:44:10
千问成全球第三大AI应用:月活达2.03亿 增速552%居首
2026-03-03 18:22:01
豆包将推出付费订阅版本
2026-05-04 14:26:17
微博 CEO 王高飞回应能否让 AI 手机自己发微博:需要确认
2025-12-08 09:17:44
字节跳动豆包上线「深度思考」推理模式,覆盖问答、搜索、写作和阅读场景
2025-03-07 09:52:46
为什么网友会觉得 这个国民软件里封印了个17岁美少女
2026-04-08 00:25:08
消息称豆包日活已破 1 亿,系字节“亿级 App”产品中花费最低
2025-12-24 20:58:04
豆包如何坐上流量王座?张一鸣“大力出奇迹” 原来全球AI都在“卷”投放
2024-12-14 09:43:34
豆包推出实时语音大模型:号称中文对话断崖式领先、情商智商均在线
2025-01-20 17:21:52
24小时热文
更多
扫一扫体验小程序