首页 > 原创笔记 > 原创笔记 > 如何减少AI“一本正经地胡诌”?新方法出现了

如何减少AI“一本正经地胡诌”?新方法出现了

发布时间:2024-06-25 16:51:54

人工智能(AI)中广泛使用的大语言模型不时出现的“一本正经地胡诌”是其难以克服的问题。近日,英国牛津大学研究团队开发出一种名为“语义熵”的新方法,有望大幅提升AI回答的可靠性。

大语言模型的“胡诌”在业界被称为“幻觉”,牛津大学计算机科学系的研究人员提出“语义熵”方法试图解决这一问题。在热力学中,熵描述的是系统的混乱或者说不稳定程度。这项研究中,熵衡量了大语言模型回答的不确定性,不确定性高意味着大语言模型的回答可能存在虚构。

该研究成果已发表在近期出版的英国《自然》杂志上。论文中说,如果AI对同一个问题,给出了许多语义相似的答案,那说明它对自己的回答比较有把握;反之,如果答案五花八门,那就意味着AI自己也“心里没底”,很可能是在“胡诌”。

研究人员利用“语义熵”方法,让大语言模型对同一问题生成多个答案,然后将语义相近的答案聚类,最后根据聚类结果计算熵值。熵值越高,表示大语言模型的回答越不确定。

值得注意的是,这一方法不仅考虑了大语言模型回答的字面差异,更关注语义层面的一致性。这使得“语义熵”能够更准确地识别AI的“胡诌”,而不会被表达方式的多样性所迷惑。

研究结果表明,“语义熵”方法在多个数据集和任务中都表现出色,能有效检测大语言模型的错误回答,并通过拒绝回答不确定的问题来提高整体准确率。更重要的是,这一方法无需修改AI模型本身,可以直接应用于现有的大语言模型。

研究人员说,“语义熵”技术有望在问答系统、文本生成、机器翻译等多个领域发挥重要作用,帮助AI生成更可靠、更有价值的内容。这不仅将提升AI在实际应用中的表现,也将增强用户对AI系统的信任。

原创笔记更多>>

日产2026款Navara在澳大利亚公布售价,起售价37413美元,共推四款车型 理想汽车将推出全新L9 Livis版,售价55.98万元 捷豹路虎将于2月9日在印度泰米尔纳德邦工厂启动极光车型组装 韩系车1月在美销量创纪录, 同比增长7.7% 小马智行与摩尔线程正式宣布达成战略合作。双方将聚焦L4级自动驾驶技术落地与规模化应用 起亚确认2026款Niro取消插电式混合动力车型 MINI马来西亚推出三款全新JCW车型 优奇无人物流车在富士康郑州工厂完成PVT下线 沃尔沃汽车2025年营收下滑11%,利润大跌99% 全新奔驰S级即将发布,CEO称其为车型历史上最大更新之一 保时捷多款纯电车型接入特斯拉超充网络 2025年欧洲车市:电气化车型销量大涨,中国品牌份额翻倍 2025年美国十大畅销电动汽车榜单发布:Model Y蝉联榜首,多款EV销量受政策退坡冲击 2025年中国乘用车市场销量已突破3010万辆的历史高位,新能源渗透率跨越51%的门槛 美国多家汽车经销商完成所有权变更 涉及八州十余宗交易 一场岛屿争端,为何让欧洲车企股价集体雪崩? 小鹏发布P7+与G7增程版 搭载5C快充及VLA 2.0 AI系统 岚图汽车与华为引望深化合作 朱江明解答:2026零跑如何冲刺100万销量 祛魅与新生:2025智能驾驶告别狂欢,驶入责任深水区 2025我被奔驰闭环了,在冰雪划出时间的形状 单月狂卖2.2万辆,一度躺进ICU的蔚来被全新ES8救活了? 比亚迪海豹08谍照!定位旗舰级轿车,配BYD最新技术,1季度亮相 聚势 向新 神龙要做新一轮合资车企的价值定义者 破局“油电同智”,上汽大众以双线智能化升级迎战2026产品大年! 百万销量筑基,2026上汽大众全面焕新反攻 12月SUV销量出炉,特斯拉一台车卖了6万多台 比亚迪王朝再放大招!宋Pro长续航版11.98万起,9系双旗舰来袭 拆解2025年度五大现象级神车,看懂中国汽车的“权力更迭” 2025年销量21万台,北京现代,缺少“爆款”车型是软肋