斯坦福大学和华盛顿大学的研究团队仅花费不到50美元的云计算费用,训练出名为s1的人工智能模型,其在数学和编程测试中的表现与OpenAI的o1和DeepSeek的r1相似。s1通过“蒸馏”技术从谷歌的Gemini 2.0 Flash Thinking Experimental模型中学习,该技术使模型能模仿高级推理能力。研究人员使用1000个精心策划的问题和答案进行训练,s1在某些基准测试中表现良好。此低成本训练引发关于人工智能模型商品化的讨论,大型科技公司可能面临挑战。s1模型及相关数据已在GitHub上开源。
原文链接
本文链接:https://kx.umi6.com/article/12664.html
转载请注明文章出处
相关推荐
换一换
1/8成本比肩Claude 3.7,Mistral Medium 3来了
2025-05-08 13:28:17
OpenAI o1 非 GPT-4o 直接进化,在成本与性能上妥协
2024-09-16 01:48:17
阿里通义千问推出全新推理模型 Qwen3-30B-A3B-Thinking-2507,多项能力显著提升
2025-07-31 07:59:58
什么是真正好用的推理模型?阶跃Step 3:开源的,多模态的,低成本的,国产芯片适配的
2025-07-28 10:09:36
OpenAI o1 推理模型 API 上线,仅面向特定开发者开放
2024-12-18 07:21:36
OpenAI两大推理模型,要把Agent吞进模型里了
2025-04-17 12:36:09
免费o1替代品来了!谷歌新发“王炸”推理大模型:思考速度碾压其他大模型,水平堪比理科博士
2024-12-23 10:51:33
OpenAI最强推理模型o3发布,首次能用图片思考
2025-04-17 09:29:43
腾讯混元全新推理模型 T1 官宣:3 月 21 日发布
2025-03-19 21:51:02
赵何娟对话李开复:推理成本预降数十倍,2025中国将从“百模大战”转向应用大战
2024-12-07 11:44:14
阶跃星辰推理模型Step R-mini上线
2025-01-16 13:54:47
DeepSeek R1遇难题142次”I give up”,研究还称需增加推理时机控制机制
2025-02-14 13:35:29
字节新推理模型逆袭DeepSeek,200B参数战胜671B,豆包史诗级加强?
2025-04-11 14:49:21
780 文章
848184 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30