3月19日,中国信息通信研究院(信通院)宣布启动AI大模型幻觉评测,旨在评估大模型在生成内容时出现的幻觉现象。幻觉指模型输出与用户输入不符或与事实不符的内容,尤其在医疗、金融等重要领域的应用中,这一问题引发关注。此次评测以大语言模型为对象,涵盖事实性幻觉和忠实性幻觉两种类型,并设置了包括人文科学、社会科学、自然科学等在内的五大测试维度。评测数据包含超7000条中文样本,测试形式分为信息抽取、知识推理及事实判别等题型。信通院邀请相关企业参与,共同推进大模型的安全应用。
原文链接
本文链接:https://kx.umi6.com/article/15744.html
转载请注明文章出处
相关推荐
.png)
换一换
昆仑万维方汉:大模型的技术红利在消退,商业模式创新者将成赢家 | MEET 2025
2024-12-23 16:58:52
无问芯穹领航铸造模速空间算力生态平台,助造全球最大AI孵化器
2025-02-22 12:34:16
当智能变成平的
2025-02-28 09:02:36
455 文章
80036 浏览
24小时热文
更多

-
2025-07-22 00:23:59
-
2025-07-21 22:23:40
-
2025-07-21 21:25:24