Agent 的引用溯源机制:当模型输出自带来源标注

发布时间:2026/9/22 7:23:33

Agent 的引用溯源机制:当模型输出自带来源标注 构建一个基于文档回答的 Agent 时最让人头疼的问题不是 Agent 答不出来而是它答出来的内容你没法验证。用户问根据这份合同违约金是多少Agent 返回了一个数字。用户信了。但你怎么知道它没看错条款你说我让它引用原文但靠 Prompt 要求模型输出引用结果要么是模型自己编造了原文citation hallucination要么是引用格式不统一前端没法渲染。这个问题在 RAG 应用中尤其突出。当 Agent 从多个文档中检索信息再组织成回答时用户看到的是模型整理后的文本而不是原始证据。你没法判断这个结论是来自文档还是模型自己推断的。企业级场景下这种不可验证性直接决定了 Agent 能不能上线。Anthropic 的 Citations 特性解决的就是这个具体问题让模型在回答时自动标注每条结论来自哪个文档的哪个位置并且返回原文片段。关键在于这不是靠 Prompt 提示模型请引用原文而是 API 层面的结构化机制——模型输出时API 自动解析出引用关系返回结构化的 citation 对象包含被引用的原文文本和文档中的精确位置。引用机制的技术拆解先看最基础的使用方式。在 API 请求中把文档以document类型的内容块传入并在文档上设置citations.enabled: trueresponse client.messages.create( modelclaude-opus-5, max_tokens1024, messages[ { role: user, content: [ { type: document, source: { type: text, media_type: text/plain, data: The grass is green. The sky is blue., }, title: My Document, context: This is a trustworthy document., citations: {enabled: True}, }, {type: text, text: What color is the grass and sky?}, ], } ], )关键点在于citations.enabled是设置在文档上的不是全局参数。这意味着你可以同时传入需要引用的文档和不需要引用的文档但当前版本要求同一个请求中要么全部启用要么全部禁用。响应结构是理解这个特性的核心。模型返回的content不再是一个完整的文本块而是被拆分成多个文本块每块可能附带一组citations{ content: [ {type: text, text: According to the document, }, { type: text, text: the grass is green, citations: [ { type: char_location, cited_text: The grass is green., document_index: 0, document_title: Example Document, start_char_index: 0, end_char_index: 20, } ], }, {type: text, text: and }, { type: text, text: the sky is blue, citations: [ { type: char_location, cited_text: The sky is blue., document_index: 0, document_title: Example Document, start_char_index: 20, end_char_index: 36, } ], } ] }每个citation对象包含被引用的原文片段cited_text、所属文档的索引document_index、文档标题document_title以及根据文档类型不同的位置信息。对于纯文本文档位置信息是字符索引范围对于 PDF是页码范围对于自定义内容文档是内容块索引范围。cited_text不计入输出 Token——这是需要特别注意的工程细节。如果你的应用之前靠 Prompt 让模型输出引用每次引用都会消耗输出 Token 和对应的费用。使用 Citations 特性后cited_text由 API 直接从文档中提取不产生额外 Token 消耗。三种文档类型的选择策略Anthropic 支持三种文档类型每种有不同的分块策略和引用格式文档类型分块方式引用格式适用场景纯文本按句子分块字符索引范围标准文档、文章PDF按句子分块页码范围扫描件、正式报告自定义内容不额外分块内容块索引范围列表、转录、RAG 分块纯文本和 PDF 文档会被自动按句子分块模型可以引用单个句子或多个连续句子。自定义内容文档则让你自己控制分块粒度——你把内容按你的逻辑切好模型直接引用你提供的块。这个选择对 RAG 场景有直接影响。如果你的 RAG 系统已经对文档做了分块处理每个块是一个独立的检索单元那么使用自定义内容文档类型把每个 RAG 块作为一个独立的内容块传入可以避免 API 再次分块带来的不确定性。反之如果想让 API 自动处理分块使用纯文本类型即可。流式场景下的引用处理Citations 在流式响应中以citations_delta事件类型到达。当使用 Server-Sent Events 流式接收响应时引用数据会以独立的 delta 事件发送event: content_block_delta data: {type: content_block_delta, index: 0, delta: {type: citations_delta, citation: { type: char_location, cited_text: ..., document_index: 0, }}}这意味着前端需要处理两种 delta 类型text_delta用于渲染文本citations_delta用于在对应文本块上附加引用信息。如果前端已经在处理流式文本渲染需要额外处理citations_delta事件来更新引用标注。与 Prompt Caching 的配合Citations 和 Prompt Caching 可以同时使用。文档内容可以被缓存而引用结果不会缓存——每次请求都会重新生成引用。在文档上设置cache_control即可response client.messages.create( modelclaude-opus-5, max_tokens1024, messages[ { role: user, content: [ { type: document, source: { type: text, media_type: text/plain, data: long_document, }, citations: {enabled: True}, cache_control: {type: ephemeral}, }, {type: text, text: What does this document say?}, ], } ], )对于长度超过缓存阈值的文档这个组合能显著降低重复请求的输入 Token 成本。需要注意引用结果本身不缓存但文档内容是缓存的有效部分。重要边界与结构化输出的不兼容Citations 不能和结构化输出Structured Outputs一起使用。如果在文档上启用citations.enabled同时在请求中设置了output_config.format参数API 会返回 400 错误。原因是引用需要在文本输出中穿插 citation 块这与严格 JSON Schema 约束的结构化输出不兼容。这个限制在实际工程中意味着如果你的 Agent 需要同时做两件事——从文档中提取信息需要引用和输出结构化数据需要结构化输出——你需要拆成两轮调用。第一轮用 Citations 获取带引用的文本回答第二轮用结构化输出提取关键字段。或者放弃引用直接用结构化输出提取数据。工程落地建议如果团队已经在用 Prompt 方式让模型输出引用迁移到 Citations 特性后有几个直接收益Token 成本降低cited_text 不计入输出 Token、引用可靠性提升API 保证引用指向真实文档位置、引用质量改善官方评估表明 Citations 特性比纯 Prompt 方式更倾向于引用最相关的原文。但 Citations 特性不是万能的。它只适用于在请求中直接传入文档的场景对 Agent 工具调用返回的结果不生效。如果 Agent 通过工具从外部系统获取数据这些数据需要先以document类型传回给模型才能启用引用。这意味着你需要调整 Agent 的调用链工具返回的数据→以document类型传给模型→模型回答时自动引用。另一个需要注意的点是当前版本要求所有文档要么全部启用引用要么全部禁用。如果某些文档不需要引用但又不想被排除可以考虑把这些文档以普通文本类型传入而不是作为document类型。对于生产环境建议在用户侧或管理后台展示引用来源。cited_text可以直接渲染为可点击的高亮文本document_title和位置信息可以作为 tooltip 或脚注展示。这比纯文本回答多了一层交互但用户对 Agent 回答的信任度会显著提升。Citations 特性解决的不是模型能力问题而是可信度问题。当模型回答可以追溯到具体原文时Agent 从黑盒生成器变成了可验证的信息整理器。对于企业级 RAG 应用、合同审查 Agent、合规问答系统等场景这种可验证性可能是能否上线的分水岭。学习资源推荐如果你想更深入地学习大模型以下是一些非常有价值的学习资源这些资源将帮助你从不同角度学习大模型提升你的实践能力。一、全套AGI大模型学习路线AI大模型时代的学习之旅从基础到前沿掌握人工智能的核心技能​因篇幅有限仅展示部分资料需要点击文章最下方名片即可前往获取二、640套AI大模型报告合集这套包含640份报告的合集涵盖了AI大模型的理论研究、技术实现、行业应用等多个方面。无论您是科研人员、工程师还是对AI大模型感兴趣的爱好者这套报告合集都将为您提供宝贵的信息和启示​因篇幅有限仅展示部分资料需要点击文章最下方名片即可前往获取三、AI大模型经典PDF籍随着人工智能技术的飞速发展AI大模型已经成为了当今科技领域的一大热点。这些大型预训练模型如GPT-3、BERT、XLNet等以其强大的语言理解和生成能力正在改变我们对人工智能的认识。 那以下这些PDF籍就是非常不错的学习资源。因篇幅有限仅展示部分资料需要点击文章最下方名片即可前往获取四、AI大模型商业化落地方案作为普通人入局大模型时代需要持续学习和实践不断提高自己的技能和认知水平同时也需要有责任感和伦理意识为人工智能的健康发展贡献力量。
延伸阅读

更多相关文章

2026/9/19 23:24:44

滚动回测思想

滚动回测(Rolling / Walk-Forward Backtest) 是量化投资与时序建模中用于验证策略时效性的动态评估方法。它通过随时间推移不断滑动训练与测试窗口,真实模拟策略在实盘中定期重新训练、参数微调与再平衡的全过程。 与传统“一次性划分训练集与…

2026/9/19 23:24:48

办公文档转换工具记录:多款文档转换器能力边界整理

办公资料整理、学习资料归档过程中,经常遇到文档格式不兼容的情况。不同文档转换工具在格式覆盖、排版还原、批量处理、扫描文件识别能力上存在差异。下文客观记录多款文档转换工具基础能力与使用局限,本文无任何商业合作,不区分好坏优劣&…

2026/9/22 7:20:11

黄家驹头像速查手册:3步搞定前端头像压缩与加载优化

黄家驹头像速查手册:3步搞定前端头像压缩与加载优化 官方文档堆砌了上百页的图像优化理论,新人根本抓不住重点。 你需要一份能直接上手的 速查手册 ,而不是让你翻遍 RFC 规范去猜浏览器行为。 本文不讲虚的,直接拆解 黄家驹头像…

2026/9/22 7:20:11

拉钩备考保姆级教程:3步搞定证书年审与查询

拉钩备考保姆级教程:3步搞定证书年审与查询 报错一堆看不懂?StackTrace 满屏红字?别慌,这其实是很多刚接触技术或转行小伙伴的通病。 今天这篇 保姆级教程 ,不聊虚的,专门针对大家在【拉钩】招聘平台上找机会时,经常被 HR…

2026/9/22 7:20:11

3招搞定狗狗简笔画生成器,实战项目避坑指南

3招搞定狗狗简笔画生成器,实战项目避坑指南 配置环境就卡半天?别急,这是每个转行做开发的朋友都经历过的噩梦。 我见过太多人在安装依赖时,因为版本冲突或网络超时,直接放弃了一个 实战项目…

2026/9/22 7:20:11

3个面试翻车案例拆解kfc宅急送实战项目

3个面试翻车案例拆解kfc宅急送实战项目 面试被问“kfc宅急送”的订单状态机怎么实现,我愣了三秒。不是没写过,是只照着视频敲代码,没啃过底层逻辑。后来复盘发现,80%的初学者都在犯同一个错:把 实战项目…

2026/9/22 7:15:11

2026最新:包含的英文性能优化实战,告别官方文档陷阱

2026最新:包含的英文性能优化实战,告别官方文档陷阱 翻过几百页官方文档,还是没搞懂【包含的英文】到底慢在哪?这不是你不够努力,是资料太碎。2026最新的实战经验表明,性能瓶颈往往藏在最不起眼的地方。别被那些长篇大论吓退,咱们直接看代码。…

2026/9/21 3:28:31

GAMP 5 基于风险的计算机化系统验证:软件分类与审计追踪实践

简介:《A Risk-Based Approach to Compliant GxP Computerized Systems》即业内熟知的GAMP 5指南,面向制药企业质量与IT合规人员、验证工程师及计算机化系统管理者,用于解决GxP法规环境下系统合规性难以科学落地的问题。文档以风险管理为主线…

2026/9/21 3:33:19

安全托管MSSP实战:从静态防御到人机协同的攻防运营与应急响应

简介:这份PPT围绕互联网业务安全托管服务展开,面向企业安全负责人、IT运维人员及关注MSSP/MSS选型的读者,重点回应传统安全过度依赖人工、碎片化静态防御难以对抗产业化攻击等痛点。资源共1个pptx文件,包体约30.63MB,以…

2026/9/22 0:04:49

输电线路在线监测高频面试题拆解 3秒抓住官方文档重点

输电线路在线监测高频面试题拆解 3秒抓住官方文档重点 官方文档几百页翻到头还是懵?面试问到 输电线路在线监测 的数据链路时,脑子一片空白?别慌,这种 高频面试题 我整理了10年,专门治各种“文档太长抓不住重点”的毛病。…

2026/9/22 0:04:49

中介房源管理系统重构避坑:3个关键步骤搞定API变更

中介房源管理系统重构避坑:3个关键步骤搞定API变更 版本升级后 API 全变了,这种痛只有真做过的人懂。 很多团队在接手老旧房产项目时,最崩溃的不是代码烂,而是底层框架升级后,原本熟悉的接口调用方式彻底失效。 这份 保姆级教程…

2026/9/22 0:04:49

3个坑点带你一文搞懂55gg小游戏源码

3个坑点带你一文搞懂55gg小游戏源码 盯着控制台满屏的红色报错,看着那一长串 StackTrace ,是不是脑子瞬间宕机?别急,这种时候最忌讳的就是盲目改代码。很多刚入行的前端同学,面对 55gg 小游戏这类轻量级 H5…

2026/9/20 4:54:47

USB Type-C PCB布局分区设计:电源、高速信号与PD协议全攻略

做硬件这行,Type-C接口算是典型的“看着简单,做起来全坑”的东西。光引脚就24个,高低速信号、电源、控制线全部塞在一个小小的连接器里,如果PCB布局不做规划,打样回来基本就是“插上没反应”、“高速掉线”、“静电一打…

2026/9/21 18:32:12

系统编程学习原型如何补齐稳定性边界

系统编程学习原型如何补齐稳定性边界预算有限时&#xff0c;我先优化明显多余的复制&#xff0c;而不是猜测性地换容器。用借用传递只读数据通常就能减少分配&#xff1a; fn parse(line: &str) -> Result<Item, Error> { /* ... */ }用基准确认热点确实在分配&am…

2026/9/21 10:29:02

雨花区哪家财务公司代理记账比较好?

在雨花区&#xff0c;企业处理财税事务常常面临诸多挑战&#xff0c;选择一家靠谱的财务公司至关重要。湖南巨勤财务管理咨询有限公司就是本地正规实体财税服务机构&#xff0c;深耕本地工商财税行业多年&#xff0c;熟悉当地工商局、税务局最新政策与申报流程。主营公司注册、…

还想了解更多?直接咨询顾问

免费诊断 + 免费方案 + 透明报价。

全国咨询热线400-8866-253
免费获取方案
咨询二维码