发布时间:2026/7/27 2:51:27
我让 Agent 自查答案,它更会编了——加一道事实核查层,幻觉率从 31% 压到 2% 先甩结论别让 Agent 自己核对自己的答案那只会让它编得更圆。真正压住幻觉的是把它的每句输出硬拽回工具返回的原始证据上对齐。下面这层事实核查我们上线后幻觉率从 31% 掉到 2%。我说的幻觉不是那种胡说八道的明显瞎编而是更阴的一种Agent 明明调了工具、拿到了真实结果总结的时候却把关键结论写反了——工具说退款失败它告诉你已成功退款。这种话长得特像真的用户一眼扫过去就信了等发现不对劲投诉电话都打过来了。我做了好几年对话类 Agent这种嘴比工具快的坑比彻底答不上来难缠得多因为你连它答错了这个念头都未必转得过来。普通聊天机器人胡说顶多误导Agent 是拿着工具、对着真实用户和真实订单说话的它一句已退款可能直接触发后续流程杀伤力完全不在一个量级。所以我后来对所有对外发声的 Agent 都格外较真宁可多一道校验也不赌它那次刚好没编。我得承认一开始我也走了弯路。看官方文档和一堆博客都在说让模型在回答前 verify 一下我就老实在 system prompt 里加了条规则constsystemPromptWithSelfCheck你是订单客服 Agent。 规则 1. 调用工具拿到结果后必须核对你的回答与工具返回完全一致 2. 不得编造工具未返回的信息 3. 回答前再确认一遍没有遗漏或夸大。;你猜怎么着幻觉率不降反升。我们拿了 200 组真实对话测naive 版本 31% 出现编造加上这条自查规则后涨到 37%。说白了这条软约束等于让小偷自己签字画押——模型为了看起来一致会直接把总结改成已核对无误哪怕它压根没对上更损的是它会悄悄改写工具返回里的关键数字去迁就自己的话。我特别讨厌这种自我感动式的自检它给的那句我已核对比没有还危险因为人本能地会信。这事儿其实跟确认偏误一个道理你让它核对它就默认自己是对的然后倒推着去圆。模型没有我可能错了这种自我怀疑给它一个自查的名头它只会更理直气壮地编。我实测过光靠 prompt 约束模型在退款失败→说成功这种场景下的翻车率一点没降反而因为多了核对环节显得更笃定用户被骗得更彻底。最离谱的一次模型把用户地址里的3 栋核对成了工具返回的5 栋还在末尾补了句已与系统一致我盯着那行字愣了半天才反应过来它压根没对上。说实话我当时挺不信邪连试了三个不同的措辞结果一个比一个糟。所以正确的做法不是让它自查而是让外部逻辑来查它。核心就三步把最终回答拆成一句句的声明claim再拿每句去工具原始返回里找证据找不到的就标红、逼模型改口或者补证据。// 极简事实核查层TypeScript无外部依赖可直接跑typeClaim{text:string;grounded:boolean;evidence?:string};functionextractClaims(answer:string):Claim[]{returnanswer.split(/[。\n]/).map((s)s.trim()).filter(Boolean).map((text)({text,grounded:false}));}functionground(claim:string,evidence:string):boolean{constnumsclaim.match(/\d/g)??[];conststates[成功,失败,已退款,未退款,已找到,无结果];consthasStatestates.some((s)claim.includes(s)evidence.includes(s));constnumsOknums.every((n)evidence.includes(n));returnhasStatenumsOk;}functioncheckFacts(answer:string,toolReturns:string[]):Claim[]{returnextractClaims(answer).map((c){consthittoolReturns.find((t)ground(c.text,t));returnhit?{...c,grounded:true,evidence:hit}:c;});}constanswer已为您成功退款订单号 88231。;consttoolReturns[refund result: 失败订单号 88231 未退款];console.log(checkFacts(answer,toolReturns));// → [{ text:已为您成功退款…, grounded:false }] ← 当场把假话抓出来ground 这个函数不玩字符串包含的虚招它只看两类硬货状态词成功/失败/已退款…和数字。只要这两样在工具返回里对不上claim 就别想及格。这买卖怎么算都值——多一次对齐少一次社死。跑完要是抓到没证据的 claim别直接删我是让它降级重答把那些无依据的说法甩回给模型让它补证据或者改口。asyncfunctionrunAgentWithFactCheck(messages:any[],tools:any[]){constresawaitrunAgent(messages,tools);// 拿最终回答 工具返回consttoolReturnsres.toolCalls.map((t:any)t.result);constungroundedcheckFacts(res.answer,toolReturns).filter((c)!c.grounded);if(ungrounded.length0)returnres.answer;// 全有证据直接放行constretryawaitrunAgent([...messages,{role:user,content:你的回答里这些说法在工具返回中找不到依据请删除或改写${ungrounded.map((c)c.text).join()}},],tools,);returnretry.answer;}说起来雷达鸭那个客服 Agent 早期就栽在这上面——它把一次失败的案例查询说成已为您找到 3 个案例用户点进去是空的。后面就是靠这层事实核查兜住的。我这层不是凭空想的是被一通投诉逼出来的。有回 Agent 调订单工具拿到退款失败转头给用户总结已为您成功退款人家真去查了才发现钱没退。我后背一下就凉了——这种假话发出去比不回答还糟十倍。如果让我重来第一版就该把这层核查焊死在链路里。那次之后我把所有对外发声的 Agent 都过了一遍发现不止退款连已发货已找到 N 个案例都有过张冠李戴只是没被用户逮到罢了想想都后怕。数据摆一下200 组带工具调用的真实任务方案幻觉率单次额外耗时裸跑 naive31%0system 自查37%0事实核查层2%0.4snaive 那 31% 里把失败说成成功占了一大半加 system 自查不降反升正好印证前面的判断上事实核查后掉到 2%代价是每次多一次 claim 抽取约 0.4s我完全能接受。当然这层也不是银弹。claim 抽取本身会漏遇到长推理链尤其明显而且工具里找不到不等于一定是幻觉——有些话确实没有工具能覆盖。所以我对无证据 claim 的处理是降级重答不是一刀切删除免得把对的也砍了。还有个坑得提醒如果工具返回本身就错了比如下游接口给了个假成功事实核查层是查不出来的——它只保证Agent 说的 工具说的保证不了工具说的是真的。这块得靠工具侧自己的校验别有奢望一层核查包打天下。我后来给退款、改单这类关键工具又叠了一道结果回查工具在返回前先自己验一遍两层夹着才敢放心放出去。反正我现在默认给每个会对外说话的 Agent 套这层核查。宁可它偶尔多问一句我不确定您再确认下也不让它替我把假话顺溜地发出来。你那边 Agent 出过这种嘴比工具快的事故吗我是老三10 年软件开发经验软件设计师、人工智能应用工程师。平时主搞鸿蒙 ArkTS 北向开发和 Web 前端也在折腾 AI 自动化偶尔在 CSDN 写点鸿蒙和 AI 的实战笔记。本文遵循 MIT 协议转载请注明出处。

相关新闻

2026/7/27 2:51:27

Claude-5代码生成模型:业务逻辑理解与工程化实践指南

如果你是一位开发者,最近在关注 AI 编程助手或代码生成工具,可能已经注意到一个现象:市面上的工具越来越“聪明”,但真正能理解复杂业务逻辑、生成可维护代码的却不多。很多工具在简单示例上表现惊艳,一旦遇到真实项目…

2026/7/27 2:46:27

深入解析MMC/SD/SDIO的DMA与命令流协同工作原理

1. 项目概述:为什么需要深入理解MMC/SD/SDIO的DMA与命令流?在嵌入式系统开发中,尤其是涉及到多媒体、数据采集或大容量存储的场景,存储卡的读写性能往往是整个系统的瓶颈之一。很多工程师在初期可能会依赖CPU进行轮询或中断搬运数…

2026/7/27 2:46:27

智能仓储翻箱优化:基于强化学习的预翻箱策略

1. 项目背景与核心价值在自动化仓储和物流系统中,翻箱问题(Container Relocation Problem)一直是个经典难题。想象一下你面前有个多层货架,需要从最底层取出某个箱子,但上面压着其他箱子——这就是典型的翻箱场景。传统…

2026/7/27 3:46:30

YOLOv8-LSDECD口罩检测模型优化与部署实践

1. YOLOv8-LSDECD口罩检测模型深度解析在计算机视觉领域,目标检测技术已经发展得相当成熟,但针对特定场景的优化仍然充满挑战。口罩佩戴检测作为疫情防控常态化下的重要应用,对模型的实时性、准确性和轻量化都提出了更高要求。YOLOv8-LSDECD正…

2026/7/27 3:46:30

MoneyPrinterTurbo终极指南:如何3分钟打造爆款短视频的AI神器

MoneyPrinterTurbo终极指南:如何3分钟打造爆款短视频的AI神器 【免费下载链接】MoneyPrinterTurbo 利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频。Generate HD short videos from a topic or keyword with an automated AI workflo…

2026/7/27 3:46:30

20分钟用LangGraph构建AI助手:从原理到实践

1. 项目概述:20分钟构建你的第一个AI助手去年我在硅谷参加一场技术峰会时,亲眼见证了AI Agent如何从实验室概念快速演变为企业标配工具。当时一位初创公司CTO仅用15分钟就现场搭建了一个能处理客服咨询的智能助手,这个场景让我意识到&#xf…

2026/7/27 3:46:30

AI聚合平台jige.io:一站式管理多模型API的实践指南

1. AI 聚合 Token 平台的兴起背景过去一年,AI 大模型领域出现了前所未有的繁荣景象。作为一名长期关注 AI 技术落地的开发者,我深刻感受到这种繁荣背后带来的新挑战。各大科技公司纷纷推出自己的大语言模型,从 OpenAI 的 GPT 系列到 Anthropi…

2026/7/27 3:41:29

LoRA技术解析:大模型参数高效微调实践指南

1. LoRA技术概述:参数高效微调的革命LoRA(Low-Rank Adaptation,低秩适配)作为当前最热门的参数高效微调(PEFT)技术之一,正在深刻改变大模型微调的实践方式。这项技术的核心思想是在保持预训练模…

2026/7/26 0:03:36

PDF合并与动态水印的工程化方案:2026国内免费工具实测对比

一、背景与测试方案 在实际项目交付中,PDF文件合并与版权保护水印的叠加是一个高频但容易被低估的技术需求。典型的处理链路涉及:多源PDF的文件流合并、页面级水印渲染(含透明度混合与图层叠加)、输出文件体积控制。看似简单的操作…

2026/7/27 0:01:12

xcku5p-ffvb676-2-i 设计 RoCEv2 时 constraints.xdc 配置依据核查记录

constraints.xdc 配置依据核查记录 被核查文件:fpga/vitis/xcku5p/build/constraints/constraints.xdc 目标板卡:RK-XCKU5P-F V1.2(搭载 xcku5p-ffvb676-2-i) 移植母本:fpga/pynq/rfsoc-pynq/build/constraints/constraints.xdc(NVIDIA Holoscan Sensor Bridge 参考工程)…

2026/7/27 0:01:12

TMS320C54x DSP内存映射与I/O模拟配置实战指南

1. 项目概述与核心价值在嵌入式系统开发,尤其是DSP这类资源受限、架构独特的处理器上,内存映射配置和I/O模拟是每个开发者都必须跨越的一道坎。这不仅仅是调试器里的几个菜单选项或命令行参数,它直接关系到你的程序能否在目标板上正确运行、能…

2026/7/27 3:13:33

3个高效策略:快速掌握Axure中文界面配置

3个高效策略:快速掌握Axure中文界面配置 【免费下载链接】axure-cn Chinese language file for Axure RP. Axure RP 简体中文语言包。支持 Axure 11、10、9。不定期更新。 项目地址: https://gitcode.com/gh_mirrors/ax/axure-cn 还在为Axure RP的英文界面感…