最新最快科技资讯
太阳能光伏网

中国信通院发起大模型幻觉测试,助力AI安全应用

为应对大模型幻觉带来的潜在风险,中国信息通信研究院人工智能所基于AI Safety Benchmark测评工作,正式开展大模型幻觉测试。大模型幻觉指生成内容看似合理但与事实或用户输入不符的现象,尤其在医疗、金融等领域广泛应用时,其风险不容忽视。

本次测试聚焦大语言模型,涵盖事实性幻觉和忠实性幻觉两种类型,采用7000余条中文样本,涉及人文、社会、自然、应用及形式科学五大维度。测试形式包括信息抽取、知识推理和事实判别等题型,旨在全面评估模型表现。

中国信通院诚邀相关企业参与测评,共同推动大模型的安全与深度应用。

最新相关

传吉利旗下魅族Flyme Auto将上车奔驰E

36氪汽车从多位知情人士了解到,奔驰已和亿咖通、星纪魅族达成合作,Flyme Auto即将进入奔驰中国车型序列。最先搭载Flyme Auto的奔驰车型是长轴距版E-Class。一位消息人士透露,合作车型预计会在...