1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

中国电信于1月25日发布“复杂推理大模型”TeleAI-t1-preview,该模型在美国数学竞赛AIME 2024及MATH500评测中分别取得60和93.8分,大幅超越OpenAI o1-preview、GPT-4o等标杆模型。在GPQA Diamond测试中,TeleAI-t1-preview得分超过GPT-4o,接近Claude 3.5 Sonnet的表现。TeleAI-t1-preview不仅能解决《九章算术》中的题目,还能进行古今单位换算,并结合形象思维与抽象思维进行推理。该模型采用了创新的训练策略,包括高质量推理数据集构建、Judge Model评估、SFT阶段的高质量长推理数据生成及强化学习阶段的Rule-based Reward Model应用。

原文链接
本文链接:https://kx.umi6.com/article/12183.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
国产大模型首发中文逻辑推理,「天工大模型4.0」o1版来了
2024-11-28 10:23:25
大语言模型会推理吗?
2024-11-13 11:33:40
TeleAI “复杂推理大模型” 达竞赛级数学表现,评分超 o1-preview
2025-01-26 17:15:51
两句话,让 LLM 逻辑推理瞬间崩溃!最新「爱丽丝梦游仙境」曝出 GPT、Claude 等重大缺陷
2024-06-10 18:37:26
两句话,让LLM逻辑推理瞬间崩溃!最新「爱丽丝梦游仙境」曝出GPT、Claude等重大缺陷
2024-06-10 21:37:45
MIT 新研究指出 AI 不懂“no”,逻辑推理缺陷导致否定词成“盲区”
2025-05-22 09:22:19
懂你、能交付、专业操作:金山办公田然给出AI办公助理的三项标准
2026-07-22 11:55:53
全球首发技术路线+全域联盟双轮破局,AI for ADANES释放先进核能新质生产力
2026-07-20 18:27:07
苹果iOS 27开发者预览版Beta 4发布:国行iPhone期待的Siri AI继续缺席
2026-07-21 06:51:16
SoulAgent亮相WAIC 2026:智能参会重塑前沿知识传播范式
2026-07-20 13:21:24
姚卯青、张正友、徐丹飞等七位大佬同席,这届 WAIC 把具身未来聊透了
2026-07-20 16:19:36
苏度 WAIC 首秀:从1到10+技能跃迁,探索通用机器人 Scaling 路径
2026-07-19 15:24:53
“败家”的马斯克:卖车赚的钱 全烧给AI了
2026-07-24 00:14:08
24小时热文
更多
扫一扫体验小程序