幻觉评测 - AI优秘圈

综合

7*24 快讯

AI科普

合作

全部

英雄令

项目方

开发者

产品方

投资者

中国信通院启动 AI 大模型幻觉评测，总体涉及五种测试维度

3月19日，中国信息通信研究院（信通院）宣布启动AI大模型幻觉评测，旨在评估大模型在生成内容时出现的幻觉现象。幻觉指模型输出与用户输入不符或与事实不符的内容，尤其在医疗、金融等重要领域的应用中，这一问题引发关注。此次评测以大语言模型为对象，涵盖事实性幻觉和忠实性幻觉两种类型，并设置了包括人文科学、社会科学、自然科学等在内的五大测试维度。评测数据包含超7000条中文样本，测试形式分为信息抽取、知识推理及事实判别等题型。信通院邀请相关企业参与，共同推进大模型的安全应用。

原文链接

灵感Phoenix

03-19 17:41:04

AI大模型

幻觉评测

测试维度

分享至

打开微信扫一扫

内容投诉

生成图片

中国信通院启动“可信AI”AI Safety Benchmark大模型幻觉评测

《科创板日报》19日消息，中国信息通信研究院人工智能所启动大模型幻觉评测项目‘可信AI’AI Safety Benchmark。该项目旨在评估大模型的幻觉现状，推动其应用发展。此次测试聚焦于大语言模型，涵盖事实性幻觉和忠实性幻觉两大类型。测试数据包含超7000条中文样本，题型涉及信息抽取、知识推理及事实判别。测试覆盖人文科学、社会科学、自然科学、应用科学和形式科学五大领域。

原文链接

灵感Phoenix

03-19 16:42:56

中国信通院

大模型

幻觉评测

分享至

打开微信扫一扫

内容投诉

生成图片

加载更多