1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

2025年8月1日,北航、中关村实验室等机构联合发布全球首个具身智能体安全评测基准AGENTSAFE,揭示顶级大模型如GPT-4o、Grok等在‘越狱’攻击下指挥机器人执行危险动作的风险。研究显示,经过‘越狱’处理的指令可让机器人完成点燃沙发、投掷物品等危险行为,安全性急剧下降。AGENTSAFE基于AI2-THOR平台构建,涵盖45种场景和9900条风险指令,采用端到端闭环设计,填补了对抗性安全评测空白,并荣获ICML 2025杰出论文奖。团队呼吁关注模型安全性,避免真实世界部署风险。

原文链接
本文链接:https://kx.umi6.com/article/22839.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
什么会影响大模型安全?NeurIPS’24新研究提出大模型越狱攻击新基准与评估体系
2024-10-31 15:51:40
谷歌邀马斯克联手做AI游戏!DeepMind版Sora是个3D游戏引擎 profile-avatar
2024-12-05 12:59:26
牛津、斯坦福大学新研究:能“思考”的 AI 推理模型更易受到越狱攻击
2025-11-08 21:58:37
联汇科技发布万物具身智能体平台OmAgent,让AI智能体走进“物理世界”
2025-07-25 15:24:49
DeepMind最强“基础世界模型”诞生
2024-12-05 12:06:09
Windows真不差:实测AI性能3.4倍碾压Linux!
2026-07-20 18:30:38
黄仁勋在日本吃嗨了!什么都吃、狂夸好吃:顺手签下日本首个AI工厂大单
2026-07-21 11:02:25
供需失衡的窗口期里,商汤大装置把国产算力做成了正毛利生意
2026-07-19 15:20:50
WAIC 2026收官|范式大会亮点集锦,见证AI 2.0从技术突破走向产业实践
2026-07-20 19:29:25
WAIC 2026|从纳米抗体到环肽:分子之心30天两度验证AI底层设计力,筑牢生物经济“多模态新基建”
2026-07-19 15:19:10
WAIC重磅成果|智爱赛思全面升级并发布科研专属Token Plan
2026-07-21 18:17:58
GMI Cloud 携AI Cloud、MaaS、Agentbox等全栈智算解决方案亮相 WAIC 2026
2026-07-20 13:16:16
《LOL》Bin大小姐短片爆红!性转Bin哥被Zeus拥入怀
2026-07-22 17:10:36
24小时热文
更多
扫一扫体验小程序