我让 Agent 自查答案,它更会编了——加一道事实核查层,幻觉率从 31% 压到 2%
先甩结论别让 Agent 自己核对自己的答案那只会让它编得更圆。真正压住幻觉的是把它的每句输出硬拽回工具返回的原始证据上对齐。下面这层事实核查我们上线后幻觉率从 31% 掉到 2%。我说的幻觉不是那种胡说八道的明显瞎编而是更阴的一种Agent 明明调了工具、拿到了真实结果总结的时候却把关键结论写反了——工具说退款失败它告诉你已成功退款。这种话长得特像真的用户一眼扫过去就信了等发现不对劲投诉电话都打过来了。我做了好几年对话类 Agent这种嘴比工具快的坑比彻底答不上来难缠得多因为你连它答错了这个念头都未必转得过来。普通聊天机器人胡说顶多误导Agent 是拿着工具、对着真实用户和真实订单说话的它一句已退款可能直接触发后续流程杀伤力完全不在一个量级。所以我后来对所有对外发声的 Agent 都格外较真宁可多一道校验也不赌它那次刚好没编。我得承认一开始我也走了弯路。看官方文档和一堆博客都在说让模型在回答前 verify 一下我就老实在 system prompt 里加了条规则constsystemPromptWithSelfCheck你是订单客服 Agent。 规则 1. 调用工具拿到结果后必须核对你的回答与工具返回完全一致 2. 不得编造工具未返回的信息 3. 回答前再确认一遍没有遗漏或夸大。;你猜怎么着幻觉率不降反升。我们拿了 200 组真实对话测naive 版本 31% 出现编造加上这条自查规则后涨到 37%。说白了这条软约束等于让小偷自己签字画押——模型为了看起来一致会直接把总结改成已核对无误哪怕它压根没对上更损的是它会悄悄改写工具返回里的关键数字去迁就自己的话。我特别讨厌这种自我感动式的自检它给的那句我已核对比没有还危险因为人本能地会信。这事儿其实跟确认偏误一个道理你让它核对它就默认自己是对的然后倒推着去圆。模型没有我可能错了这种自我怀疑给它一个自查的名头它只会更理直气壮地编。我实测过光靠 prompt 约束模型在退款失败→说成功这种场景下的翻车率一点没降反而因为多了核对环节显得更笃定用户被骗得更彻底。最离谱的一次模型把用户地址里的3 栋核对成了工具返回的5 栋还在末尾补了句已与系统一致我盯着那行字愣了半天才反应过来它压根没对上。说实话我当时挺不信邪连试了三个不同的措辞结果一个比一个糟。所以正确的做法不是让它自查而是让外部逻辑来查它。核心就三步把最终回答拆成一句句的声明claim再拿每句去工具原始返回里找证据找不到的就标红、逼模型改口或者补证据。// 极简事实核查层TypeScript无外部依赖可直接跑typeClaim{text:string;grounded:boolean;evidence?:string};functionextractClaims(answer:string):Claim[]{returnanswer.split(/[。\n]/).map((s)s.trim()).filter(Boolean).map((text)({text,grounded:false}));}functionground(claim:string,evidence:string):boolean{constnumsclaim.match(/\d/g)??[];conststates[成功,失败,已退款,未退款,已找到,无结果];consthasStatestates.some((s)claim.includes(s)evidence.includes(s));constnumsOknums.every((n)evidence.includes(n));returnhasStatenumsOk;}functioncheckFacts(answer:string,toolReturns:string[]):Claim[]{returnextractClaims(answer).map((c){consthittoolReturns.find((t)ground(c.text,t));returnhit?{...c,grounded:true,evidence:hit}:c;});}constanswer已为您成功退款订单号 88231。;consttoolReturns[refund result: 失败订单号 88231 未退款];console.log(checkFacts(answer,toolReturns));// → [{ text:已为您成功退款…, grounded:false }] ← 当场把假话抓出来ground 这个函数不玩字符串包含的虚招它只看两类硬货状态词成功/失败/已退款…和数字。只要这两样在工具返回里对不上claim 就别想及格。这买卖怎么算都值——多一次对齐少一次社死。跑完要是抓到没证据的 claim别直接删我是让它降级重答把那些无依据的说法甩回给模型让它补证据或者改口。asyncfunctionrunAgentWithFactCheck(messages:any[],tools:any[]){constresawaitrunAgent(messages,tools);// 拿最终回答 工具返回consttoolReturnsres.toolCalls.map((t:any)t.result);constungroundedcheckFacts(res.answer,toolReturns).filter((c)!c.grounded);if(ungrounded.length0)returnres.answer;// 全有证据直接放行constretryawaitrunAgent([...messages,{role:user,content:你的回答里这些说法在工具返回中找不到依据请删除或改写${ungrounded.map((c)c.text).join()}},],tools,);returnretry.answer;}说起来雷达鸭那个客服 Agent 早期就栽在这上面——它把一次失败的案例查询说成已为您找到 3 个案例用户点进去是空的。后面就是靠这层事实核查兜住的。我这层不是凭空想的是被一通投诉逼出来的。有回 Agent 调订单工具拿到退款失败转头给用户总结已为您成功退款人家真去查了才发现钱没退。我后背一下就凉了——这种假话发出去比不回答还糟十倍。如果让我重来第一版就该把这层核查焊死在链路里。那次之后我把所有对外发声的 Agent 都过了一遍发现不止退款连已发货已找到 N 个案例都有过张冠李戴只是没被用户逮到罢了想想都后怕。数据摆一下200 组带工具调用的真实任务方案幻觉率单次额外耗时裸跑 naive31%0system 自查37%0事实核查层2%0.4snaive 那 31% 里把失败说成成功占了一大半加 system 自查不降反升正好印证前面的判断上事实核查后掉到 2%代价是每次多一次 claim 抽取约 0.4s我完全能接受。当然这层也不是银弹。claim 抽取本身会漏遇到长推理链尤其明显而且工具里找不到不等于一定是幻觉——有些话确实没有工具能覆盖。所以我对无证据 claim 的处理是降级重答不是一刀切删除免得把对的也砍了。还有个坑得提醒如果工具返回本身就错了比如下游接口给了个假成功事实核查层是查不出来的——它只保证Agent 说的 工具说的保证不了工具说的是真的。这块得靠工具侧自己的校验别有奢望一层核查包打天下。我后来给退款、改单这类关键工具又叠了一道结果回查工具在返回前先自己验一遍两层夹着才敢放心放出去。反正我现在默认给每个会对外说话的 Agent 套这层核查。宁可它偶尔多问一句我不确定您再确认下也不让它替我把假话顺溜地发出来。你那边 Agent 出过这种嘴比工具快的事故吗我是老三10 年软件开发经验软件设计师、人工智能应用工程师。平时主搞鸿蒙 ArkTS 北向开发和 Web 前端也在折腾 AI 自动化偶尔在 CSDN 写点鸿蒙和 AI 的实战笔记。本文遵循 MIT 协议转载请注明出处。

相关新闻

Claude-5代码生成模型:业务逻辑理解与工程化实践指南

Claude-5代码生成模型:业务逻辑理解与工程化实践指南

如果你是一位开发者,最近在关注 AI 编程助手或代码生成工具,可能已经注意到一个现象:市面上的工具越来越“聪明”,但真正能理解复杂业务逻辑、生成可维护代码的却不多。很多工具在简单示例上表现惊艳,一旦遇到真实项目…

2026/7/27 2:51:30 阅读更多 →
自注意力机制原理与Transformer实战指南

自注意力机制原理与Transformer实战指南

1. 自注意力机制:深度学习序列建模的革命2017年,Google Brain团队在《Attention Is All You Need》论文中提出的Transformer架构,彻底改变了序列建模的游戏规则。作为其核心组件的自注意力机制(Self-Attention Mechanism&#xff…

2026/7/27 2:50:29 阅读更多 →
Petri Net与LLM结合:解决Rust并发API状态复杂性的测试生成方法

Petri Net与LLM结合:解决Rust并发API状态复杂性的测试生成方法

并发编程的测试困境:当你的 Rust API 状态复杂到连自己都理不清时,如何保证多线程下的正确性?传统单元测试往往只能覆盖简单的线性路径,而真正的并发 bug 总是在那些意想不到的交错执行中悄然出现。今天要介绍的方法,结…

2026/7/27 2:50:29 阅读更多 →

最新新闻

C/C++实现LU分解:从算法原理到高性能工程实践

C/C++实现LU分解:从算法原理到高性能工程实践

1. 项目概述:为什么LU分解是数值计算的基石如果你写过C或C程序来处理线性方程组,比如在图形学里做坐标变换,或者在物理模拟中求解受力平衡,那你大概率绕不开一个核心算法:LU分解。我第一次接触它是在大学的一门数值分析…

2026/7/27 3:06:35 阅读更多 →
三相两电平逆变器DPWM调制技术解析与应用

三相两电平逆变器DPWM调制技术解析与应用

1. 三相两电平逆变器DPWM调制技术解析 三相两电平逆变器作为电力电子领域的核心功率变换装置,其调制策略直接影响着系统效率、谐波特性以及器件损耗。在众多PWM调制技术中,不连续PWM(DPWM)因其独特的开关损耗优化特性,…

2026/7/27 3:06:35 阅读更多 →
C++面向对象核心:从类与对象到内存模型与面试实战

C++面向对象核心:从类与对象到内存模型与面试实战

1. 项目概述:从面试真题出发,重构C核心知识体系最近在帮团队筛选一些C方向的候选人,也翻看了不少网上流传的“华为OD机试”或“C八股文”题目。我发现一个挺有意思的现象:很多题目看似在考语法细节,比如“虚函数表指针…

2026/7/27 3:06:35 阅读更多 →
火山云豆包AI交互技术解析与优化实践

火山云豆包AI交互技术解析与优化实践

1. 火山云豆包:AI交互新标杆的技术解析作为一名长期跟踪AI技术发展的从业者,我最近深度测试了火山引擎推出的云豆包模型。这款产品在技术架构和用户体验上的创新确实让人眼前一亮。不同于市面上大多数AI助手仅停留在问答层面,云豆包实现了从底…

2026/7/27 3:06:35 阅读更多 →
基于YOLOv8n改进的电动车头盔检测系统优化实践

基于YOLOv8n改进的电动车头盔检测系统优化实践

1. 项目背景与核心价值电动车头盔检测系统是当前智慧交通和公共安全领域的热门应用。去年参与某地交警部门的实际项目时,我们发现传统人工抽查方式存在效率低、覆盖面窄的问题——一个路口高峰期需要3名警力值守,而部署我们的初版检测系统后,…

2026/7/27 3:06:35 阅读更多 →
C盘搬家工具:智能迁移技术原理与实战指南

C盘搬家工具:智能迁移技术原理与实战指南

1. 项目概述:C盘搬家工具的核心价值作为一名有着12年系统维护经验的IT工程师,我见过太多因为C盘爆满导致系统卡顿的案例。上周就遇到一位设计师同事,PS工程文件频繁崩溃,检查发现C盘剩余空间不足500MB。这种场景下,传统…

2026/7/27 3:05:35 阅读更多 →

日新闻

【JAVA毕设源码分享】基于SpringBoot的社区智能垃圾管理系统的设计与实现(程序+文档+代码讲解+一条龙定制)

【JAVA毕设源码分享】基于SpringBoot的社区智能垃圾管理系统的设计与实现(程序+文档+代码讲解+一条龙定制)

博主介绍:✌️码农一枚 ,专注于大学生项目实战开发、讲解和毕业🚢文撰写修改等。全栈领域优质创作者,博客之星、掘金/华为云/阿里云/InfoQ等平台优质作者、专注于Java、小程序技术领域和毕业项目实战 ✌️技术范围:&am…

2026/7/27 0:00:54 阅读更多 →
SPI实战指南:从时钟模式到寄存器配置,解决嵌入式通信难题

SPI实战指南:从时钟模式到寄存器配置,解决嵌入式通信难题

1. 项目概述:从寄存器手册到实战指南 如果你手头有一份类似德州仪器(TI)TMS320x240xA系列DSP的SPI模块技术手册,看着里面密密麻麻的寄存器位定义、时序图和公式,是不是感觉头大?这份资料虽然权威&#xff0…

2026/7/27 0:00:54 阅读更多 →
【JAVA毕设源码分享】基于springboot的水果购物管理系统的设计与实现(程序+文档+代码讲解+一条龙定制)

【JAVA毕设源码分享】基于springboot的水果购物管理系统的设计与实现(程序+文档+代码讲解+一条龙定制)

博主介绍:✌️码农一枚 ,专注于大学生项目实战开发、讲解和毕业🚢文撰写修改等。全栈领域优质创作者,博客之星、掘金/华为云/阿里云/InfoQ等平台优质作者、专注于Java、小程序技术领域和毕业项目实战 ✌️技术范围:&am…

2026/7/27 0:00:54 阅读更多 →

周新闻

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 数据集6000张 完整源码已标注数据集训练好的模型环境配置教程程序运行说明文档,可以直接使用!系统支持图片、视频、摄像头等多种方式检测裂缝,功能强大实用。 1数据集6000张 8各类别

2026/7/26 0:00:31 阅读更多 →
深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

pubg数据集 精选原图1.42万数据 1.49万标签 无任何重复、算法增强或冗余图像! pubg绝地求生目标检测数据集 1分类:e_body,14905个标签,txt格式 共计14244张图,99%为640*640尺寸图像 适合yolo目标检测、AI训练关键词&am…

2026/7/26 0:00:31 阅读更多 →
Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex检测数据集数据集详情检测类别: allies enemy tag图片总量:7247张训练集:5139张验证集:1425张测试集:683张标注状态:全部已标注,即拿即用数据格式:支持YOLO格式及其他格式&#…

2026/7/26 0:00:31 阅读更多 →

月新闻