新闻详情

新闻详情

首页 / 资讯中心 / 详情

wenyi文译实时术语表实战:自动抽取专名、检测译法冲突,彻底告别前后不一

发布时间:2026/10/1 16:14:53来源:尧图网络
wenyi文译实时术语表实战:自动抽取专名、检测译法冲突,彻底告别前后不一
wenyi文译实时术语表实战自动抽取专名、检测译法冲突彻底告别前后不一【免费下载链接】wenyi将被语言阻隔的作品带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/gh_mirrors/we/wenyiwenyi文译是一款面向长篇小说的 AI 翻译工具其核心亮点之一是实时术语表翻译每完成一批段落就会自动从原文与译文中抽取人名、地名、称谓等专名写入术语库约束后续翻译一旦发现同一原文术语出现了不同译法立即记录为译法冲突等你人工裁决——从此彻底告别前后不一。无论你是用 Web 界面还是 CLI 命令行wenyi 的术语表都会边翻译、边积累、边校验让几百章的长作品始终保持命名一致。一个术语表要解决的痛点长作品翻译最头疼的不是翻不出句子而是同一个角色在第 3 章叫艾伦第 40 章变成阿伦。传统做法是人工整理一张 Excel 术语表再祈祷模型每次都遵守。wenyi 的做法是把术语表变成翻译流程的活零件自动抽取——不靠你手动整理模型边翻边把新专名提炼进库按需注入——每批次只注入本章匹配到的词条无关术语不占上下文冲突留痕——已定译法不会被自动覆盖新译法进入冲突队列等待裁决。官方对术语库的定位描述得很清楚它用于约束后续翻译并为最终审校提供证据。详见 docs/zh/pipeline.md。自动抽取三步闭环抽取、对齐、冲突检测第一步从已译段落里抽取专名每翻译完一个批次GlossaryExtractor会拿原文片段 译文片段 现有术语表调用轻量模型返回结构化的候选词条原文source、译名target、读音reading、类型person/term/appellation/honorific 等、性别、别名和备注。抽取不是无脑全量注入——如果传入全书语料只有出现至少两次的现有词条才会被注入提示词低频词条保留在库中但不反复消耗上下文这在 packages/core/wenyi_core/glossary/extractor.py 中实现。第二步首次译法对齐更巧妙的是历史对齐机制。当一个新术语此前已在前面章节被翻译过抽取器会找到该术语第一次出现的原译文对照让模型判断库里这条译名和当初实际怎么翻的是否一致一致 → 词条入库能判断 → 改用首次译法入库保证全书口径统一不确定 →暂缓入库避免把一个错误的译名固化、污染后续文本。相关逻辑见 extractor.py 中的 _align_with_first_occurrences。第三步冲突检测绝不静默覆盖GlossaryStore.upsert_term的裁决规则非常克制见 packages/core/wenyi_core/glossary/store.py情形处理新术语直接入库inserted译名相同合并别名、补全读音/性别/备注unchanged译名不同保留已确立译法新译法写入term_conflicts表词条标记为conflict等待人工裁决也就是说自动抽取永远不会偷偷改掉你确认过的译名——所有分歧都摆在明面上。Web 端管理术语表搜索、批量操作与冲突裁决在 Web 端术语表是独立导航页前端实现在 apps/web/src/features/glossary/GlossaryPage.tsx一个表格覆盖全流程搜索与筛选按原文、译名或别名搜索按人物 / 术语 / 称谓 / 敬语 / 口癖 / 固定表达六类筛选增删改弹窗添加或编辑词条含读音、性别、别名、备注支持多选批量删除导入导出支持 CSV / JSON 双向导入导出导入时若与现有词条冲突会逐条列出由你选择覆盖还是跳过冲突裁决页面底部琥珀色卡片列出所有未解决冲突每条对比当前译法与AI 建议点一下保留当前或采纳建议即可裁决后所有相关冲突自动关闭。后端对应的 REST 接口在 apps/api/wenyi_api/routers/glossary.py包括术语增删改查、/conflicts列表与/conflicts/{cid}/resolve裁决、JSON/CSV 导入导出。⚠️ 小提示翻译任务运行中术语表保持只读编辑需先暂停任务避免写冲突。CLI 快速排查三条命令掌握全书译名偏好命令行的用户wenyi CLI 提供了完整的术语管理子命令实现在 packages/cli/wenyi_cli/commands/glossary.pyuv run wenyi glossary list book.epub # 列出全部已确立译名与状态 uv run wenyi glossary conflicts book.epub # 查看未解决的译法冲突 uv run wenyi glossary resolve book.epub 原文术语 指定译名 # 裁决并关闭冲突list以表格展示 Source / Translation / Type / Status状态为conflict的词条一目了然conflicts逐条打印现有译法 vs 建议译法含出现章节resolve调用 resolver.py把最终译法写回术语库并关闭该术语的全部冲突。这三条命令在 docs/zh/usage.md 的独立阶段与术语管理一节有完整说明。术语一致性还能再进一步吗术语表负责约束未来而已完成的历史段落怎么办wenyi 的答案是把术语库作为审校证据review阶段会用最终术语库全书检查译文中的译名漂移发现问题可结合--autofix发布修订。人工校阅页面则让你逐段核对原文与译文逐段确认译名统一。此外docs/zh/configuration.md 提供了glossary_scope配置chapter只注入本章相关术语默认省上下文full注入全量术语表更严格。而术语抽取与历史对齐两个操作默认路由到fast档模型既省成本又保持响应速度。小结wenyi 文译的实时术语表把译名一致从人工纪律变成了工程机制自动抽取每批翻译完成后即刻提炼新专名无需手动维护首次译法对齐新词条优先对齐历史首次译法不确定就暂缓⚖️冲突留痕译法分歧不静默覆盖Web 与 CLI 双端一键裁决审校兜底术语库同时作为 Review 证据历史漂移也能被发现。从第 1 章到第 500 章专名自始至终一个译法——这就是实时术语表带给长作品翻译的确定性。【免费下载链接】wenyi将被语言阻隔的作品带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/gh_mirrors/we/wenyi创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

Windows恢复环境丢失怎么办:WinRE重建与reagentc修复指南 2026/10/1 17:01:07

Windows恢复环境丢失怎么办:WinRE重建与reagentc修复指南

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

阅读更多 →
Unity人物渲染性能优化实战:从骨骼蒙皮到材质阴影 2026/10/1 17:01:06

Unity人物渲染性能优化实战:从骨骼蒙皮到材质阴影

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

阅读更多 →
MathType花体字设置全攻略:样式切换、LaTeX对应与问题排查 2026/10/1 17:00:59

MathType花体字设置全攻略:样式切换、LaTeX对应与问题排查

前两天,一个做理论计算的朋友跑来问我:MathType里到底怎么打花体字?他说百度搜了半天,全是"花体字代码",什么𝒜ℬ𝒞样子的字符一大堆,复制进公式全乱套了。这个问题我太熟…

阅读更多 →
React Native鸿蒙横向滚动分页实现:ScrollView参数、踩坑与组件选型 2026/10/1 17:00:59

React Native鸿蒙横向滚动分页实现:ScrollView参数、踩坑与组件选型

先说一个我前阵子遇到的场景。公司要把历史遗留的React Native项目往鸿蒙上迁移,我分到的第一个任务不是复杂的业务逻辑,而是一个看着特别不起眼的功能:横向滚动分页。轮播图、新手引导、横向卡片切换,这套东西在iOS和Android上我…

阅读更多 →
小番茄检测实战:VOC标注转YOLO格式与训练全流程 2026/10/1 17:00:52

小番茄检测实战:VOC标注转YOLO格式与训练全流程

简介:YOLO小番茄目标检测数据集面向计算机视觉学习者、农业智能化开发者及科研人员,聚焦小番茄果实识别这一具体场景,解决成熟度判别与自动采摘中的目标定位难题。压缩包内含1790个文件,由895张不同角度、光照条件下拍摄的PNG图片…

阅读更多 →
PyTorch内部机制深度解析:从Tensor、Autograd到算子执行 2026/10/1 17:00:51

PyTorch内部机制深度解析:从Tensor、Autograd到算子执行

PyTorch 用久了,总会有那么一个时刻,你盯着报错信息发呆:明明张量形状对得上,梯度却传不回去;或者loss.backward()跑完,某个中间变量的.grad是None。这时候翻文档往往只能查到 API 签名,真正想搞…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞 ✉