拓冰建站拓冰建站
首页 / 资讯中心 / 正文

如何用Wenyi省Token?strong/cheap/fast三档模型路由完全指南

如何用Wenyi省Tokenstrong/cheap/fast三档模型路由完全指南【免费下载链接】wenyi将被语言阻隔的作品带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/BigDawnGhost/wenyiWenyi 是一款开源的 AI 多语言小说翻译工具能把被语言阻隔的作品带到读者的语言中。翻译一本长篇网文动辄消耗几十万 Token而模型路由正是省 Token 的核心Wenyi 内置了strong强/ cheap省/ fast快三个模型档位把不同的流水线步骤分配给不同档位的模型——重要步骤用强模型保证质量大批量、低风险步骤用便宜模型控成本。本文带你用 5 个步骤把 Token 开销压到合理区间。先看懂strong / cheap / fast 三档分别管什么Wenyi 把翻译流程拆成一个个注册操作operation每个操作默认绑定一个档位。打开 packages/core/wenyi_core/llm/operations.py 可以看到全部操作这里是最常用的几类档位定位典型操作strong质量敏感的核心步骤正文翻译、标题翻译、润色、审校取证与修订cheap大量调用、容错高的步骤语言检测、注释定位、审校初扫⚡fast短输出、重速度的步骤章节梗概、全书概要、术语抽取与对齐举个例子translation.body正文翻译走 strongreview.scan审校初扫走 cheapsynopsis.chapter章节梗概走 fast。三档默认指向同一个预设的三套模型配置你可以分别替换任意一档不用改动代码。第 1 步查看当前生效的模型路由改配置前先用 CLI 看清每个操作实际走哪个模型uv run wenyi models list uv run wenyi models explain --operation review.verify uv run wenyi models check --for translatelist输出所有操作的路由表操作 → 档位 → 模型 → 并发上限explain解释单个操作的完整选择链check只校验密钥不发送任何请求这三个命令都不联网命令实现见 packages/cli/wenyi_cli/model_commands.py。第 2 步配置文件中 5 个最省 Token 的开关编辑工作目录下的 config.yaml首次运行会自动生成带注释的默认文件重点关注pipeline区块开关默认省 Token 效果polish: true开⭐ 最大头。强模型对全书译文再润色一遍成本显著快速出稿可关book_understanding: true开预扫全书生成梗概关掉可省掉全部预扫请求review: true开全书审校会调用多个操作--no-review可跳过glossary_scope: chapterchapter保持默认只带本章术语比full全量术语表省很多rolling_context_segments: 66翻译时附带的前文段数调小即省输入 Token对应命令行快捷开关uv run wenyi translate input.epub --no-polish --no-review 新手建议正式出书用默认全开日常试译、批量跑样章时加--no-polish --no-reviewToken 消耗能降一大截。第 3 步三档模型路由的精细调法预设llm.preset: deepseek展开为default_strong/default_cheap/default_fast三套模型配置三个档位独立映射分别替换即可。有三种由浅入深的省法1把 cheap 档换成低价模型最推荐在 config.yaml 的llm段追加models与tiers覆盖让cheap指向更便宜的模型如deepseek-flashstrong/fast 保持不动。这样语言检测、审校初扫、注释定位自动全部降费。2routes 单独覆盖某个操作不想动档位也可以只给高消耗操作指定专用模型llm: preset: deepseek models: flash: provider: default model: deepseek-flash routes: polish.body: {model: flash} synopsis.book: {model: flash}每条路由必须写{model: 配置名}或{tier: 档位}二选一配置错误会在发请求前直接报错不会静默回退。3budget 给整次运行设硬上限llm: budget: max_requests: 500 # 最多请求次数 max_tokens: 2000000 # 最多消耗 Token deadline_seconds: 7200 # 最长时间这是防超支的保险丝达到上限后运行会协作式停下已完成结果保留、可随时续跑不会把余额跑光。完整的规则与提供商选项见官方文档 docs/zh/configuration.md。第 4 步Web 用户的一键方案——快速出稿模板如果你用 Wenyi 的 Web 界面还有更省事的路径。创建项目时选择快速出稿流程模板它会自动关闭全书预理解、润色、审校与自动修复只保留正文与术语翻译是目前最快的省 Token 姿势。之后也可以在设置 → 总设置中统一管理三档模型与步骤路由apps/web/src/features/settings/每个操作的下拉框直接显示实际档位。第 5 步验证省了多少——看用量账本每本书的用量都会记入独立账本CLI 下是目标目录里的usage.json跨续跑累计Web 端则在翻译总览页按步骤 / 模型 / 提供商三个维度展示能直观看到审校扫描、润色等操作各吃了多少 Token。账本还支持by_tier视图帮你确认便宜档位的调用是否真的落在 cheap 模型上——这是验证第 3 步路由是否生效的最好办法。小结wenyi models list先看清路由现状试译阶段关掉polish与review正式出书再全开把cheap档换成低价模型性价比最高的长期省法用llm.budget设置 Token 硬上限防超支Web 用户直接用快速出稿模板跑完后看用量账本按步骤确认节省效果模型档位只代表偏好而非实测质量混用多提供商前建议先用公版样章对比效果。省 Token 的同时保住翻译质量才是 Wenyi 模型路由设计的最初目标。【免费下载链接】wenyi将被语言阻隔的作品带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/BigDawnGhost/wenyi创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门