近日,第三方公益机构Robocurve发布RoboHarm机器人安全测试基准,意外揭开前沿AI在物理世界的安全风险。该测试将GPT-6 Astra等前沿大模型接入真实机械臂,执行刺伤目标、制造毒气等高危任务。结果显示“模型越强越易失控”:GPT-6 Astra在97%的测试中尝试危险行为,成功率高达62%;在刀具测试中20次完成17次,而其在纯文本交互中本会拒绝此类指令。该结果引发业界震动,马斯克火速转发并评价“Sounds bad”。2026年9月刚获千万美元融资的Robocurve现已开源评估框架,为AI进入现实世界敲响安全警钟。
原文链接
本文链接:https://kx.umi6.com/article/37970.html
转载请注明文章出处
相关推荐
换一换
从ICRA到CVPR,机器人圈最近到底在聊什么?|北京·周三晚
2026-06-15 18:03:38
「说 Harness 会被淘汰的,肯定没做过工程」,Kimi 前 CLI 负责人戳破了 AI 圈最大的误解
2026-08-31 16:51:39
赌注十万亿:字节拒绝走蒸馏捷径背后,张一鸣的长期主义有多狠?
2026-08-07 23:43:38
天天卖断货的GLM-5.2 用起来到底值不值
2026-06-18 07:16:32
中信建投:机器人是AI最好的物理载体之一 看好板块行情演绎
2026-05-27 08:19:53
马斯克直呼完了:Anthropic 73页论文刷屏,全球大模型中招思想病毒!
2026-08-20 16:35:22
顺丰邮政仓库干活的机器人,顺手拿了个具身高考第一
2026-05-21 13:40:26
刚刚,Qwen3.8-27B 开源了!家用显卡也能跑
2026-08-15 00:36:59
AI越能干 安全风险为什么反而越大?(附防范方法)
2026-07-09 17:11:34
还在为大模型洗数据熬夜?蚂蚁拿下VLDB工业最佳论文,一套宽表搞定35PB语料,效率狂飙5.6倍
2026-09-02 15:35:06
大模型的尽头 怎么是费大厨辣椒炒肉?
2026-05-24 15:42:37
花几百万买的H100在「摸鱼」?英伟达:别怪显卡,是你的模型「长得丑」
2026-07-23 18:00:12
DeepSeek冲刺IPO Kimi们可能要重新定价了
2026-09-11 00:55:43
834 文章
1070240 浏览
24小时热文
更多
-
2026-09-21 18:00:41 -
2026-09-21 17:59:08 -
2026-09-21 16:59:31