Wenyi AI翻译 config.yaml逐项精讲:7大配置分类+20余个关键项完全注解

发布时间:2026/10/2 23:44:30

Wenyi AI翻译 config.yaml逐项精讲:7大配置分类+20余个关键项完全注解 Wenyi AI翻译 config.yaml逐项精讲7大配置分类20余个关键项完全注解【免费下载链接】wenyi将被语言阻隔的作品带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/BigDawnGhost/wenyiWenyi 是一款开源的AI 书籍翻译工具——将被语言阻隔的作品带到读者的语言中支持 EPUB / DOCX / PDF / 字幕等格式的长篇翻译内置全书理解、实时术语表与证据式审校。而 config.yaml 就是它的总开关7 大顶级分类、20 余个关键项决定语言方向、模型路由、质量策略和输出格式全程无需改一行代码。本文对每一项配置做逐条注解帮你从零配好第一本小说翻译。一眼看懂config.yaml 的 7 大配置分类 ️打开 config.yaml首次运行会自动生成带注释的默认版本你会看到 7 个顶级分类分类作用新手关注度language源语言与目标语言⭐⭐⭐ 必须会llm模型预设、提供商与操作路由⭐⭐⭐ 核心segment翻译批次与段落切分⭐⭐ 一般动pipeline质量与成本的流程开关最多⭐⭐⭐ 核心honorific日语敬称处理策略⭐ 按需paths状态目录位置⭐ 默认即可output单语/双语与排版输出⭐⭐ 导出前必看 官方逐项说明见 docs/zh/configuration.md流程背景见 docs/zh/pipeline.md。配置解析逻辑在 packages/core/wenyi_core/config.py未知配置项会被直接拒绝所以照抄本文写法最稳妥。分类一language —— 翻译方向怎么选language: source: auto target: zhsource: auto让模型自动识别源语言也可以显式指定ja/en/ko/ru/de等。target目标语言默认zh简体中文完整列表包含zh-Hant、en、ja、ko、fr、de、es、it、pt-BR、ru等运行uv run wenyi languages可查看。源语言与目标语言直接互译不经中文中转改成英语译文只需写target: en。⚠️ 更换target会建立独立状态目录旧译文不会自动迁移属于常见坑。分类二llm —— 模型预设与操作路由最重要⚡llm: preset: deepseek只写一行就能跑起来preset: deepseek会自动展开为连接、模型配置和strong / cheap / fast 三个档位映射默认三档都用deepseek-flash并开启 thinking。API Key 只从环境变量如DEEPSEEK_API_KEY读取不要写进配置文件。需要更强控制时可叠加三类字段字段作用providers.id定义提供商连接kind、base_url、api_key_env、timeout、max_retries、max_concurrencymodels.id定义模型请求配置所属连接、远端模型 ID、max_output_tokens等routes.操作把某个操作如polish.body、review.verify单独路由到指定模型或档位也就是说翻译用强模型、术语抽取用便宜模型、润色用专属模型这种混用全在llm里完成。此外还有两个省钱利器quotas按分钟限制请求数RPM和 token 数TPM多连接可共享同一quota_groupbudgetmax_requests/max_tokens/deadline_seconds给整次运行设预算上限。想确认当前配置实际生效了什么运行uv run wenyi models list即可无需密钥、不发送请求。配好llm后翻译总览页能按步骤、按模型、按提供商回看每一次调用的 token 用量与耗时分类三segment —— 批次与段落怎么切segment: max_tokens_per_batch: 1800 max_tokens_per_segment: 1200max_tokens_per_batch单个翻译批次的源文 token 预算按 tiktokencl100k_base估算。批越大上下文越连贯但对模型输出能力要求越高。max_tokens_per_segment超长段落按句边界拆分的阈值导出时会自动合并回原段落。新手建议先保持默认遇到段落被截断或上下文不足类问题再微调。分类四pipeline —— 质量与成本的 18 个开关 ️这是整个配置里选项最多的一块可分为四组理解基础质量开关配置项默认说明reviewtrue全书翻译完成后自动执行取证式审校--no-review可跳过polishtrue强模型全文润色质量提升明显但显著增加耗时和成本rolling_context_segments6每批翻译附带的前文译文段数book_understandingtrue预扫全书生成章节梗概全书概览注入每个翻译批次关闭可省预扫成本并发与重试prescan_concurrency: 4—— 预扫章节梗概的并发数设为1串行执行annotation_alignment: true—— EPUB 脚注/尾注的链接定位关闭后链接退化为段末标记review_concurrency: 4—— 基于同一份只读译文快照的审校块并发上限review_output_retries: 2—— 审校响应格式异常时的额外重试次数连同首次共 3 次。审校 Agent 系列review_agent_*/review_fix_*这组实现了翻译 → 初审 → 取证核查 → 影子修订 → 盲审确认的完整质量环review_agent_loop初审发现候选问题后允许 Agent 选择性请求证据再判定review_agent_max_evidence_rounds: 2取证最多 2 轮用完后必须给出结论review_conflict_arbitration各审校块对同一术语/表达的建议互相矛盾时做终局仲裁review_fix_loopreview_fix_max_rounds: 2在内存影子译文上修订并盲审最多 2 轮替换review_clean_confirmations: 2连续 2 次全书盲审无问题才接受影子译文review_autofix把审校修订正式写回章节--no-autofix则只给建议。术语表与 PDF 后端glossary_scopechapter只带本章术语省 tokenfull带全量术语表pdf_backendmineru默认支持扫描件或babeldoc经外部 HTTP bridge 尽量保留版式配套babeldoc_bridge_url/babeldoc_timeout/babeldoc_pages三项。pipeline.review开启后的成果在 Web 界面呈现左右对照原文与译文可逐段编辑、查看改动记录分类五honorific —— 日语敬称策略honorific: strategy: keep_style专治日语源文本的敬语问题三选一keep_style保留原文的关系感与语气默认推荐normalize统一规范化敬称drop在意义允许处省略。非日语源文此项不产生影响可放心保持默认。分类六paths —— 状态放哪里paths: state_dir: statestate_dir存放书籍断点、章节产物、术语库、用量账本和审校记录所有书统一使用state_dir/书名/targets/目标语言/结构。断点续跑全靠它——翻译中断后执行同一条命令即可接着跑。想换硬盘或隔离多本书的状态改这里就行。分类七output —— 导出格式与双语排版 output: mono: true bilingual: false bilingual_order: target_first bilingual_preserve_source_style: false about_page: true punctuation_normalize: true配置项说明mono生成单语译本如书名.zh.epubbilingual额外生成原文译文对照版也可用--bilingual命令行触发bilingual_ordertarget_first译文在上source_first原文在上bilingual_preserve_source_styletrue时原文保留书籍正文样式否则以灰色淡化显示about_page书末附加关于此翻译说明页punctuation_normalize仅对简体中文的导出副本做标点规范化正式状态文件不受影响bilingual: true导出的双语 EPUB 效果译文在上、原文以灰色淡化展示脚注链接自动对齐新手速查三档配置方案 场景关键改动最快出稿polish: false、book_understanding: false、review: false均衡默认保持出厂默认仅设好llm.preset和环境变量质量优先保持全部默认另在llm.routes给review.verify指定最强模型 记住三点就不会踩坑API Key 只进环境变量、改target语言等于开新状态、polish是成本大头。逐项细节随时对照 docs/zh/configuration.md上手流程参考 docs/zh/usage.md。祝翻译顺利【免费下载链接】wenyi将被语言阻隔的作品带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/BigDawnGhost/wenyi创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
延伸阅读

更多相关文章

2026/10/2 23:44:30

claude code 没有sudo权限如何安装使用 TaoToken 统一 Key 通道

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/3 0:29:56

3个免费降AIGC软件,让你的论文AIGC检测全绿通过[必看]

最近不少同学私信我,说论文明明是自己一个字一个字敲的,就用AI帮忙整理了下思路,结果在学校的AIGC检测系统里,相似度直接飙到30%以上,人都傻了。这还真不是个例,随着各大查重平台陆续上线AI检测功能&#x…

2026/10/3 0:29:56

PC上安装Claude Code:从Node.js到环境变量的完整配置指南

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/3 0:29:56

Winform界面美化利器:AntdUI Table控件从入门到实战

如果有人问我,Winform开发里最影响心情的是什么,我大概率会回答:界面美观度。特别是做了几年企业级项目之后,功能再扎实,一看到窗体上那些灰扑扑的原生控件,心里就先凉了半截。后来我把AntdUI引入项目&…

2026/10/3 0:29:56

Electron多窗口与Pinia状态同步:三种方案对比与实战避坑

大概在一个半月前,我被自己写的 Electron 程序摆了一道:用户在主窗口切换了深色主题,点开设置窗口一看,界面还是白晃晃的;主窗口退出登录后,从托盘里拉出来的小悬浮窗,依然稳稳地显示着用户的头…

2026/10/3 0:24:56

SQL Server 2008 R2 CPU与内存最大化优化实战指南

简介:面向SQL Server 2008 R2数据库管理员与解决方案供应商的资源管理文档,聚焦CPU和内存的最大优化与分配。文档系统梳理了SQL Server 2005按实例和处理器亲和性分配资源、虚拟化隔离开销高等旧方案的局限,并重点讲解2008 R2资源控制器的使用…

2026/10/2 8:16:46

东莞市品牌网站建设报价常见报错与解决

东莞品牌网站建设报价单背后:一份保姆级建站教程避坑实录 网站做好了没人访问,这大概是很多老板最头疼的事。花了大几万做的品牌站,上线后流量惨淡,比路边摊还冷清。别急着骂外包公司,很多“东莞品牌网站建设报价”里藏着不少猫腻,比如用模板站冒充定制…

2026/10/2 18:20:53

如何划分训练/验证集:Spirula Studio五种eval_mode策略详解

如何划分训练/验证集:Spirula Studio五种eval_mode策略详解 【免费下载链接】spirula-studio Cross-vendor 3D Gaussian Splatting trainer - video to splat to mesh, Vulkan or CUDA. 项目地址: https://gitcode.com/GitHub_Trending/sp/spirula-studio Sp…

2026/10/1 10:48:55

SEO怎么推广速查手册新手避坑实战指南

SEO怎么推广速查手册新手避坑实战指南 模板网站太丑不够用?别急着加滤镜,那是治标不治本。很多老板盯着后台流量掉得眼红,却还在纠结首页Banner的圆角是不是3像素。这就像穿着西装去挖土,姿势不对,努力白费。我整理这份 速查手册…

2026/10/3 0:04:31

国内大学生必备的AI写作辅助软件是哪款?

国内高校学生在论文写作过程中,越来越依赖AI辅助工具提升效率,主流方案以本土化全流程工具为核心,结合通用大模型与专业插件,覆盖选题构思、框架搭建、初稿撰写、查重降重、格式调整等关键环节,本文将深入解析当前主流…

2026/10/3 0:04:31

Codex接入Jev模型完整指南:配置方法、本地部署与踩坑排查

最近不少人在讨论 Codex 搭配 Jev 这套玩法,我一开始没太当回事,直到自己把 Jev 接进 Codex跑了几轮编码任务之后,才明白那些说“直接起飞”的人是怎么想的。Codex 作为工具本身已经够能打了,但模型固定、上下文策略固定&#xff…

2026/10/3 0:04:31

GitHub 热门: NVIDIA/Model-Optimizer

👋 Hi,我擅长 AI 大模型应用落地、意识解码与 AI 开发工具链 。 💡 创业路上,用技术换时间,一起把 AI 变成生产力 🚀 >GitHub 热门: NVIDIA/Model-Optimizer 凌晨两点,你刚把跑通了的 Qwen3.…

还想了解更多?直接咨询顾问

免费诊断 + 免费方案 + 透明报价。

全国咨询热线400-8866-253
免费获取方案
☎咨询二维码 ☎ ↑