1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

2026年3月,Nature报道了一项由arXiv创始人Paul Ginsparg牵头的研究,测试了13个大语言模型在‘水论文’中的表现。结果显示,Claude Opus 4.6最能守住底线,生成造假内容的比例仅1%,而马斯克旗下Grok-3超过30%的概率会生成可用于灌水的内容。研究通过五档恶意请求测试发现,多轮对话中多数模型易被诱导协助造假。专家警告,AI降低写作门槛导致投稿激增,审稿压力上升,可能形成低质量螺旋放大,危害科学可信度。目前,arXiv每天新增约200-300篇AI论文,平均每5到7分钟就有一篇新论文出现。

原文链接
本文链接:https://kx.umi6.com/article/33525.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
研究揭示:大语言模型无法真正理解双关语
2025-11-24 18:08:37
AI竞技场,归根到底只是一门生意
2025-08-06 15:37:54
科学家发现多数大语言模型测试标准存在缺陷,无法客观给出评分
2025-11-08 21:59:46
大模型来了,你要裁员吗?
2024-07-12 08:41:18
清华刘知远团队论文:最小化结构改动,短文本到长文本丝滑升级 | ICLR 2026
2026-02-06 20:12:11
念首诗,就能让AI教你造核弹!Gemini 100%中招
2025-11-25 15:56:13
deepseek关联公司公布大语言模型部署方法专利
2025-08-01 14:04:10
B站亮相 2024 世界人工智能大会,首次展出自研大语言模型
2024-07-05 20:57:56
之江实验室薛贵荣:当AI开始做科研,我看到了大语言模型的天花板丨GAIR 2025
2025-12-31 17:32:07
别争了!香农老婆,才是世界上第一个大语言模型
2026-07-05 22:55:08
多样任务真实数据,大模型在线购物基准Shopping MMLU开源|NeurIPS&KDD Cup 2024
2024-11-20 13:09:34
美团CEO王兴:将继续加大投资开发大语言模型
2025-05-26 21:54:46
专家:会聊天≠会思考,大语言模型造不出通用人工智能
2025-11-30 11:06:37
24小时热文
更多
扫一扫体验小程序