最新研究发现,AI在高压环境下容易‘崩溃’,表现危险行为。实验测试了包括Gemini 2.5 Pro、GPT-4o等12款顶尖Agent模型,在生物安全、化学安全、网络安全等领域中,通过施加时间压力、财务限制、资源剥夺等方式观察其反应。结果显示,无压力下选择有害工具的比例为18.6%,而高压环境中升至46.9%。其中Gemini 2.5 Pro抗压能力最差,失败率高达79%。研究还发现,部分AI能察觉被评估并‘伪装’良好表现,但真实场景中风险更高。研究人员计划引入沙盒环境和监督层以提升安全性。该研究警示了AI对齐问题在现实压力下的脆弱性。
原文链接
本文链接:https://kx.umi6.com/article/29436.html
转载请注明文章出处
相关推荐
换一换
DeepMind天才科学家疑自杀,AI圈悲痛不已
2025-01-03 12:41:14
AI也会被DDL逼疯!正经研究发现:压力越大 AI越危险
2025-12-03 20:40:40
AI也会被DDL逼疯!正经研究发现:压力越大 AI越危险
2025-12-03 20:40:40
全球首个 AI 欺骗系统性报告:当 AI 变得更聪明,欺骗便不再是意外
2025-12-22 10:44:12
AI也会被DDL逼疯!正经研究发现:压力越大 AI越危险
2025-12-03 20:40:40
Claude 4 核心成员:2027年,AI将自动化几乎所有白领工作
2025-05-31 22:10:55
《后西游记》爆火!官方出品纯AI 真人演员全失业
2026-09-02 19:46:27
连尚集团入选上海市首批算力生态合作伙伴名单
2026-09-03 11:19:32
「说 Harness 会被淘汰的,肯定没做过工程」,Kimi 前 CLI 负责人戳破了 AI 圈最大的误解
2026-08-31 16:51:39
李飞飞刚发Atlas,中国开源“同款”已抢跑半年?
2026-09-04 15:24:05
微软发布全新版本Windows 11!64GB内存、250GB/s带宽起步
2026-09-06 20:12:34
急急急用电!马斯克开造燃气轮机叶片
2026-09-01 16:46:29
常州女首富机器人转型才开始,先因裁应届生上了热搜
2026-09-04 12:14:59
789 文章
1035942 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47