在科技界的一次重大发现中,谷歌DeepMind的一篇发表于8月的论文揭示了其原理与OpenAI最新模型o1极为相似,引发业界关注。该论文强调,增加测试时(test-time)计算比仅仅扩大模型参数规模更为有效。通过提出计算最优(compute-optimal)测试时计算扩展策略,研究显示,一个规模较小的基础模型在某些任务上能够超越一个14倍大的模型。这一发现迅速在网络上引起热议,有人指出,这几乎就是o1工作原理的体现,暗示着OpenAI可能在抢先发布预览版时已知晓此原理。 同时,OpenAI对此作出快速反应,宣布将o1-mini的速度提高7倍,每日可提供50条服务,而o1-preview的使用频率提升至每周50条。这一举措进一步加速了技术竞争的步伐。 谷歌的研究成果揭示,使用计算最优策略在减少计算量的同时,能显著提升模型性能,最多可节省4倍资源。这与OpenAI的o1模型展现出的策略相吻合,即模型通过完善自身的思维过程、尝试不同策略并学习纠正错误来提升性能,且随着更多强化学习(训练时计算)和思考时间(测试时计算)的增加,性能持续提升。 然而,业界人士也注意到,硬件成为了目前唯一可能形成“护城河”的领域。随着英伟达在算力控制上的主导地位,以及谷歌和微软可能开发出的更优定制芯片,这场技术竞赛似乎正朝着硬件性能的极限冲刺。OpenAI最近曝光的首颗芯片,采用了台积电最先进的A16埃米级工艺,旨在为Sora视频应用提供支持,再次凸显了硬件创新在大模型竞争中的重要性。 总的来说,这场围绕大模型的技术竞赛不仅在模型本身上展开激烈的角逐,还在硬件领域寻求新的突破,以期在竞争中占据优势。
原文链接
本文链接:https://kx.umi6.com/article/6409.html
转载请注明文章出处
相关推荐
换一换
英特尔王者归来 与谷歌深化CPUIPU合作:股价飙升涨近5%
2026-04-10 12:04:39
还在为大模型洗数据熬夜?蚂蚁拿下VLDB工业最佳论文,一套宽表搞定35PB语料,效率狂飙5.6倍
2026-09-02 15:35:06
上海已发布超150款备案大模型
2026-03-28 20:16:44
谷歌创始人布林紧急接管Gemini团队,但“3.5 Pro已被取消”
2026-08-11 17:41:28
持续霸榜!阿里千问3.6Plus问鼎全球大模型调用周榜冠军
2026-04-07 12:52:26
张亚勤谈大模型的未来:全球不超10个 且中美将各占三四个
2026-03-18 11:06:09
报道称谷歌来华考察液冷设备
2026-03-18 00:22:21
大模型的尽头 怎么是费大厨辣椒炒肉?
2026-05-24 15:42:37
全球开发者狂喜!Codex移除5小时限制,Fable 5订阅再延7天,有人烧token烧到住院
2026-07-13 13:10:48
刚刚,港股AGI第一股杀疯了!Agent业务半年进账近5亿,Token收入Q2暴涨500%
2026-08-28 18:21:32
硅谷刷屏的AI护城河新论:代码能抄,产品能抄,但有一样东西,谁都抄不走
2026-05-11 17:18:20
大模型也得「睡觉」了:Google 的这篇论文,戳中了AI 的最大软肋
2026-07-23 12:47:10
数学大佬在前面拓荒,AI研究员在后面捡宝,菲尔兹奖还能拿来破AI「黑盒」?
2026-07-26 17:28:08
772 文章
962759 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47