近期AI行业动态密集,涉及Scaling Law的困境、强化学习的崭露头角、OpenAI的草莓模型发布预告,以及ChatGPT Pro订阅计划的上线。首先,AI行业的普遍感受是大语言模型的进步停滞,尤其是达到数千亿参数后,成本和难度显著增加,尽管上万亿参数并未带来质变提升。硅谷共识聚焦于强化学习作为突破点,80%的公司考虑放弃预训练策略。 在强化学习领域,Claude Sonnet 3.5和DeepSeek的进展超出了预期,尤其在代码能力和数学推理方面表现出色,展现了单点突破的优势。草莓模型,即OpenAI即将发布的新模型,预计将在未来两周内面世。初步反馈显示其性能虽优于GPT-4o,但在处理简短查询时表现欠佳,速度较慢,且缺乏图像集成功能。此外,草莓模型将采用高级定价策略,预计定价为每月200美元,相较于之前传闻的2000美元,相对更为亲民。 ChatGPT Pro订阅计划的推出,售价200美元/月,提供无限制使用GPT-4o的功能,但并无其他额外服务。市场普遍认为,草莓模型的价格可能是此次订阅升级的关键因素。草莓模型旨在通过自玩强化学习(Self-play RL)方法提升数学、代码能力,实现高度智能化,但其高昂的价格反映了更高智能的开发成本和数据价值。随着OpenAI即将在11月的开发者日公布更多细节,今年AI行业的动向将成为关注焦点,或将成为新的里程碑或平淡无奇。
原文链接
本文链接:https://kx.umi6.com/article/6227.html
转载请注明文章出处
相关推荐
换一换
打破代码大模型训练瓶颈:MicroCoder将算法数据框架训练经验升级
2026-03-30 01:19:37
中金:2026年大模型在强化学习、模型记忆、上下文工程等方面将取得更多突破
2026-02-05 08:39:59
真正的AI竞争力,藏在大模型“后训练”这一步
2025-10-13 16:59:55
混元OCR模型核心技术揭秘:统一框架、真端到端
2025-11-30 11:05:21
机器狗能打羽毛球:仅靠强化学习从 0 自学,还会自己移步
2025-05-30 17:53:28
性能提升84%-166%!L-Zero仅靠强化学习解锁大模型探索世界的能力 | 已开源
2025-07-01 15:26:33
Epoch AI 预言:最快 1 年内,推理模型步伐将放缓
2025-05-14 09:09:06
清华孙茂松:对工业界而言,大厂可以Scaling,其他玩家重在垂直应用 | MEET2026
2025-12-21 10:35:20
前字节强化学习专家孙鹏博士加盟星尘智能,完善Physical AI全栈技术布局
2026-09-02 14:32:34
字节&MAP重塑大模型推理算法优化重点,强化学习重在高效探索助力LLM提升上限
2025-08-11 10:59:04
上海 AI 实验室联合清华等大学突破强化学习算法,攻克 AI 推理熵崩溃难题
2025-06-04 08:15:30
不更新参数就能强化学习!OpenAI翁家翌提出新范式:决策只需AI手搓一个.py 文件
2026-05-09 17:26:04
RLinf v0.3来了!从模型生态到真机部署五大能力跃升,无问芯穹与清华大学联合打造
2026-07-16 17:52:14
809 文章
1009415 浏览
24小时热文
更多
-
2026-09-07 18:04:51 -
2026-09-07 18:03:11 -
2026-09-07 18:01:09