新闻详情

新闻详情

首页 / 资讯中心 / 详情

如何用Wenyi省Token?strong/cheap/fast三档模型路由完全指南

发布时间:2026/10/2 21:00:51来源:尧图网络
如何用Wenyi省Token?strong/cheap/fast三档模型路由完全指南
如何用Wenyi省Tokenstrong/cheap/fast三档模型路由完全指南【免费下载链接】wenyi将被语言阻隔的作品带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/BigDawnGhost/wenyiWenyi 是一款开源的 AI 多语言小说翻译工具能把被语言阻隔的作品带到读者的语言中。翻译一本长篇网文动辄消耗几十万 Token而模型路由正是省 Token 的核心Wenyi 内置了strong强/ cheap省/ fast快三个模型档位把不同的流水线步骤分配给不同档位的模型——重要步骤用强模型保证质量大批量、低风险步骤用便宜模型控成本。本文带你用 5 个步骤把 Token 开销压到合理区间。先看懂strong / cheap / fast 三档分别管什么Wenyi 把翻译流程拆成一个个注册操作operation每个操作默认绑定一个档位。打开 packages/core/wenyi_core/llm/operations.py 可以看到全部操作这里是最常用的几类档位定位典型操作strong质量敏感的核心步骤正文翻译、标题翻译、润色、审校取证与修订cheap大量调用、容错高的步骤语言检测、注释定位、审校初扫⚡fast短输出、重速度的步骤章节梗概、全书概要、术语抽取与对齐举个例子translation.body正文翻译走 strongreview.scan审校初扫走 cheapsynopsis.chapter章节梗概走 fast。三档默认指向同一个预设的三套模型配置你可以分别替换任意一档不用改动代码。第 1 步查看当前生效的模型路由改配置前先用 CLI 看清每个操作实际走哪个模型uv run wenyi models list uv run wenyi models explain --operation review.verify uv run wenyi models check --for translatelist输出所有操作的路由表操作 → 档位 → 模型 → 并发上限explain解释单个操作的完整选择链check只校验密钥不发送任何请求这三个命令都不联网命令实现见 packages/cli/wenyi_cli/model_commands.py。第 2 步配置文件中 5 个最省 Token 的开关编辑工作目录下的 config.yaml首次运行会自动生成带注释的默认文件重点关注pipeline区块开关默认省 Token 效果polish: true开⭐ 最大头。强模型对全书译文再润色一遍成本显著快速出稿可关book_understanding: true开预扫全书生成梗概关掉可省掉全部预扫请求review: true开全书审校会调用多个操作--no-review可跳过glossary_scope: chapterchapter保持默认只带本章术语比full全量术语表省很多rolling_context_segments: 66翻译时附带的前文段数调小即省输入 Token对应命令行快捷开关uv run wenyi translate input.epub --no-polish --no-review 新手建议正式出书用默认全开日常试译、批量跑样章时加--no-polish --no-reviewToken 消耗能降一大截。第 3 步三档模型路由的精细调法预设llm.preset: deepseek展开为default_strong/default_cheap/default_fast三套模型配置三个档位独立映射分别替换即可。有三种由浅入深的省法1把 cheap 档换成低价模型最推荐在 config.yaml 的llm段追加models与tiers覆盖让cheap指向更便宜的模型如deepseek-flashstrong/fast 保持不动。这样语言检测、审校初扫、注释定位自动全部降费。2routes 单独覆盖某个操作不想动档位也可以只给高消耗操作指定专用模型llm: preset: deepseek models: flash: provider: default model: deepseek-flash routes: polish.body: {model: flash} synopsis.book: {model: flash}每条路由必须写{model: 配置名}或{tier: 档位}二选一配置错误会在发请求前直接报错不会静默回退。3budget 给整次运行设硬上限llm: budget: max_requests: 500 # 最多请求次数 max_tokens: 2000000 # 最多消耗 Token deadline_seconds: 7200 # 最长时间这是防超支的保险丝达到上限后运行会协作式停下已完成结果保留、可随时续跑不会把余额跑光。完整的规则与提供商选项见官方文档 docs/zh/configuration.md。第 4 步Web 用户的一键方案——快速出稿模板如果你用 Wenyi 的 Web 界面还有更省事的路径。创建项目时选择快速出稿流程模板它会自动关闭全书预理解、润色、审校与自动修复只保留正文与术语翻译是目前最快的省 Token 姿势。之后也可以在设置 → 总设置中统一管理三档模型与步骤路由apps/web/src/features/settings/每个操作的下拉框直接显示实际档位。第 5 步验证省了多少——看用量账本每本书的用量都会记入独立账本CLI 下是目标目录里的usage.json跨续跑累计Web 端则在翻译总览页按步骤 / 模型 / 提供商三个维度展示能直观看到审校扫描、润色等操作各吃了多少 Token。账本还支持by_tier视图帮你确认便宜档位的调用是否真的落在 cheap 模型上——这是验证第 3 步路由是否生效的最好办法。小结wenyi models list先看清路由现状试译阶段关掉polish与review正式出书再全开把cheap档换成低价模型性价比最高的长期省法用llm.budget设置 Token 硬上限防超支Web 用户直接用快速出稿模板跑完后看用量账本按步骤确认节省效果模型档位只代表偏好而非实测质量混用多提供商前建议先用公版样章对比效果。省 Token 的同时保住翻译质量才是 Wenyi 模型路由设计的最初目标。【免费下载链接】wenyi将被语言阻隔的作品带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/BigDawnGhost/wenyi创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

Flutter跨平台实战:鸿蒙书法印章应用开发与原生桥接 2026/10/2 21:57:24

Flutter跨平台实战:鸿蒙书法印章应用开发与原生桥接

我一直觉得,写毛笔字的人,案头总缺不了一两样趁手的数字化工具。练字的人都知道,落款要盖印,印文是什么、用的哪方印、盖在哪个位置、当时用的什么印泥,这些信息如果不记下来,过几个月再翻作品,…

阅读更多 →
人像后期融合网站开发全攻略:从算法到论文答辩 2026/10/2 21:57:23

人像后期融合网站开发全攻略:从算法到论文答辩

1. 题目本质与需求拆解:人像后期融合到底要做什么先聊点实际的。带过几年毕业设计,十有八九选“XX系统的设计与实现”的同学,第一反应都是上网找现成的框架,改个名字就交了。我身边也有不少同学一看到“人像后期融合网站”这个题目…

阅读更多 →
Oracle自定义加解密函数实战:从等保合规到脱敏展示 2026/10/2 21:57:14

Oracle自定义加解密函数实战:从等保合规到脱敏展示

简介:面向 Oracle 数据库管理员与开发人员的一套自定义加密解密函数方案,基于 DES 加密标准对敏感字段进行加密存储与智能脱敏处理,既保护数据隐私,又不影响后续数据分析与挖掘的准确性,可覆盖账户信息、身份证、密码、…

阅读更多 →
SQL GROUP BY原理与实战:避开HAVING和ONLY_FULL_GROUP_BY的坑 2026/10/2 21:57:12

SQL GROUP BY原理与实战:避开HAVING和ONLY_FULL_GROUP_BY的坑

前两天帮同事排查一个线上报表问题,SQL长这样: SELECT province, COUNT(*) FROM orders GROUP BY province;听着像是最基础的分组统计,结果导出来的数据怎么都不对——省份对不上、订单总数差了好几万。查了半天,发现他把GROUP …

阅读更多 →
NInfer 性能测量方法论:如何像官方一样复现 tok/s 与 TTFT 基准测试 2026/10/2 21:57:11

NInfer 性能测量方法论:如何像官方一样复现 tok/s 与 TTFT 基准测试

NInfer 性能测量方法论:如何像官方一样复现 tok/s 与 TTFT 基准测试 【免费下载链接】ninfer High-performance single-GPU inference for selected model checkpoints and GPUs. 项目地址: https://gitcode.com/gh_mirrors/ni/ninfer 想知道 NInfer 单卡推理…

阅读更多 →
HoloCubic_AIO MQTT服务器部署教程:3步为心跳APP搭建私有免费通道 2026/10/2 21:57:02

HoloCubic_AIO MQTT服务器部署教程:3步为心跳APP搭建私有免费通道

HoloCubic_AIO MQTT服务器部署教程:3步为心跳APP搭建私有免费通道 【免费下载链接】HoloCubic_AIO HoloCubic超多功能AIO固件 基于esp32-arduino的天气时钟、相册、视频播放、桌面投屏、web服务、bilibili粉丝等 项目地址: https://gitcode.com/GitHub_Trending/h…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞 ✉