北大团队发现,输入特定短语如“树中两条路径之间的距离”,能使AI模型R1陷入无限思考,无法停止,甚至在蒸馏模型Qwen上也出现相同现象。该现象如同对推理模型的DDoS攻击,造成算力资源浪费。测试显示,即使部分模型未完全陷入死循环,但思考时间显著延长。此问题可能与RL训练过程有关,模型倾向于长时间推理以获取奖励。短期内可通过限制推理时间或Token数量应对,但长远需深入研究解决方案。详情可访问GitHub。
原文链接
本文链接:https://kx.umi6.com/article/14809.html
转载请注明文章出处
相关推荐
换一换
一句话让DeepSeek思考停不下来,北大团队:这是针对AI的DDoS攻击
2025-02-28 16:15:09
AI 攻击 AI:全球超 1.7 万 Open WebUI 实例被入侵,威胁 Linux 和 Win10 / Win11 用户
2025-06-03 10:51:15
一句话让DeepSeek思考停不下来,北大团队:这是针对AI的DDoS攻击
2025-02-28 16:15:09
除夕前夜手段升级!奇安信:DeepSeek遭美国IP网攻暴力破解
2025-01-29 11:07:44
AI“看图”时的致命盲点,可窃取你的隐私数据
2025-08-26 08:39:32
具身大脑进了真实世界,难题才刚刚开始
2026-09-04 13:17:29
急急急用电!马斯克开造燃气轮机叶片
2026-09-01 16:46:29
社恐人的救星!微信内测小微AI社交:AI替你找好友聊天、约饭
2026-09-07 17:01:29
新版GPT Image 2.5已经能伪造GPT-6发布会了
2026-09-04 07:02:39
我国首个相关国标今起实施!整治AI客服已读乱回 转人工终于不难了
2026-09-01 01:08:21
在接下来70%的人生里 我可能都要问“是AI做的吗?”
2026-09-03 01:00:11
“没有Token的CS学生,应立即退学”
2026-09-03 20:39:20
赛博朋克修车!网友用笔记本跑大模型查故障:不如200元买OBD
2026-09-02 19:47:51
750 文章
964117 浏览
24小时热文
更多
-
2026-09-07 18:04:51 -
2026-09-07 18:03:11 -
2026-09-07 18:01:09