标题:OpenAI附议Ilya预训练终结!“但Scaling Law还没死”
在Ilya提出“预训练即将终结”的观点后,“Scaling Law”成为热议话题。在最近的NeurIPS会议上,OpenAI的大神Noam Brown表示,o1代表一种新的以推理计算为特点的Scaling方法。
Noam Brown指出,自2019年以来,GPT-2到GPT-4的惊人进步源于数据和算力规模的扩大。然而,大语言模型在解决如井字棋这类简单问题上仍显不足。这引发了疑问:“Scaling Law是否依然有效?”我们需要继续投入更多资源训练更好的AI吗?
Brown强调,在过去几年中,推理成本被低估了。o1引入了新的推理计算维度,这可能比单纯增加算力更为重要。例如,在扑克游戏中,增加模型的搜索时间而非单纯增加规模,可以显著提升性能。同样,在棋类游戏中,AlphaGo Zero通过推理时间搜索实现显著进步。
此外,Brown引用了关于游戏的Scaling Laws图表,表明推理时间的计算量可以大幅提高游戏结果。这是否意味着在大语言模型(LLMs)中,推理时间的计算量也能带来类似的效果?
尽管有人质疑推理时间计算并不新鲜,但Brown的观点引起了广泛关注。他认为,推理越多,系统越不可预测,这在未来AI发展中可能是一个关键因素。
这次研讨会吸引了众多观众,甚至有人在门外排队等候。尽管最初主题是数学AI,但讨论很快转向了大模型推理Scaling Law,显示了这一领域的热度与重要性。
原文链接
本文链接:https://kx.umi6.com/article/10248.html
转载请注明文章出处
相关推荐
换一换
深度解读:AI产业10大分歧
2024-08-25 13:19:51
NeurIPS 2024最佳论文揭晓!北大字节获最佳论文,清华厦大为亚军
2024-12-04 15:37:50
反转,Claude 3.5超大杯没有训练失败
2024-12-13 18:28:51
微软CTO:AI大模型的“Scaling Law”还能走多远?
2024-07-12 07:50:49
全新预训练数据筛选方案,让数据效率提升10倍!配置仅需fastText评分器|港科大vivo出品
2025-05-16 13:48:48
技术进展放缓,是普通人AI革命的开始
2024-12-25 13:03:33
怎么理解Ilya说的“AI放缓了”
2024-11-13 21:51:03
推荐场景Scaling Law来了!中科大&华为诺亚方舟联合推出
2025-03-31 15:35:17
华泰证券:长期看好AI算力需求的持续增长
2025-07-28 08:07:00
8张GPU训出近SOTA模型,超低成本图像生成预训练方案开源
2025-03-19 12:25:56
今日最热论文:Scaling Law终结,量化也不管用,AI大佬齐刷刷附议
2024-11-13 15:39:06
四位大模型创业者聊 AGI、Scaling Law 和价格战
2024-06-16 10:11:05
智源王仲远:多模态大模型对产业更加重要,得多模态大模型得天下
2024-12-31 12:40:05
751 文章
958225 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47