新闻详情

新闻详情

首页 / 资讯中心 / 详情

wenyi文译SRT字幕翻译:电影字幕快速译出,支持双语对照与断点续跑的完整指南

发布时间:2026/10/2 17:32:26来源:尧图网络
wenyi文译SRT字幕翻译:电影字幕快速译出,支持双语对照与断点续跑的完整指南
wenyi文译SRT字幕翻译电影字幕快速译出支持双语对照与断点续跑的完整指南【免费下载链接】wenyi将被语言阻隔的作品带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/gh_mirrors/we/wenyi使用wenyi 文译做 SRT 字幕翻译只需一条命令即可把电影、剧集的.srt字幕快速译出为目标语言支持--bilingual生成双语对照字幕中断后重新执行同一命令即可断点续跑已完成的批次不会重复消耗 Token。字幕路径采用滑窗批量 高并发调用速度远快于逐条翻译且状态文件轻量、开箱即用。为什么用 wenyi 翻译字幕更省心市面上很多字幕翻译脚本一次性翻译中断即作废长片动辄上万条字幕中途网络波动就得全部重来。wenyi 文译把书籍翻译中成熟的批次检查点机制搬到了字幕场景⚡滑窗并发每次批量处理 20 条字幕、相邻批次重叠 10 条保持语境连贯最多 100 路并发调用 strong 档模型断点续跑已完成的批次缓存在state/srt/slug/targets/目标语言/batches/再次运行自动跳过双语对照--bilingual一键生成原文译文对照的.zh-bi.srt方便对照校对轻量路径不建术语库、不跑全书审校专注快速出片无需额外配置。快速开始一条命令译出电影字幕先在项目文档中查看 中文使用说明配置好模型后translate命令会按扩展名自动把.srt分流到字幕管线uv run wenyi translate movie.srt # 默认输出单语 output/movie.zh.srt uv run wenyi translate movie.srt --bilingual # 同时生成双语对照 movie.zh-bi.srt uv run wenyi translate movie.srt --no-mono --bilingual # 只出双语版翻译完成后终端会打印译出条数、总条数、Token 用量与耗时统计产物默认落在源文件旁的output/目录。字幕路径不支持--chapter、--format等书籍选项传入时会明确报错提示。断点续跑中断后如何无缝恢复长电影字幕翻译动辄几十分钟遇到断网、限流或手动停止都很正常。wenyi 的做法很直接——再次对同一源文件执行同一命令即可续跑每次成功翻译的批次会写入batches/缓存下次运行直接复用不再请求模型cues.jsonl逐条记录每条字幕的index / timestamp / source / target / status恢复时从状态文件重建进度usage.json跨续跑累计 Tokenevents.jsonl追加记录运行事件与重试方便事后对账。状态目录布局如下全部为纯文本文件可读可检查state/srt/slug/targets/目标语言/ manifest.json # 源文件身份SHA-256、字幕条数、滑窗配置 cues.jsonl # 每条字幕的译文与完成状态 batches/ # 模型原始批次结果供续跑 usage.json # 跨 resume 累计 token timing.json # 累计执行时长 events.jsonl # 运行事件与 LLM 重试观察 提示manifest 会校验源文件 SHA-256若你修改了字幕源文件再续跑会提示使用独立状态目录避免新旧状态混用。双语对照与单语输出怎么选输出控制有两种开关默认只出单语版单语版output/文件名.zh.srt纯译文直接挂到播放器即可双语版加--bilingual生成文件名.zh-bi.srt每条字幕译文一行 原文一行适合教学、校对场景。输出偏好也可以在 配置文件说明 中通过output.mono与output.bilingual持久设置命令行参数优先。字幕翻译走srt.translate操作路由默认使用strong档模型可在llm.routes中单独调整不影响书籍管线配置。字幕管线的实现原理简述字幕翻译的核心逻辑位于 srt/translate.py状态管理在 srt/store.py读取与写盘分别由 srt_reader.py 和 srt_writer.py 负责批量 JSON 翻译模型以 JSON 形式一次性返回整批字幕译文失败批次自动重试 3 次单条兜底批量仍未覆盖的缺失条目会并发逐条补译仍失败则保留原文保证产物完整原子落盘cues 写入采用临时文件 原子替换进程锁串行化并发写异常中断也不会损坏状态文件用量可审计每次批次完成即增量合并 Token 用量即使中途打断也会落盘不会白算。上手检查清单translate movie.srt单语输出是否正常生成于output/--bilingual双语版逐条是否译文在上、原文在下翻译中途 CtrlC 后重跑是否跳过已缓存批次、Token 无重复消耗state/srt/下usage.json、events.jsonl是否有累计记录长片大字幕是否按预期并发跑完终端耗时统计是否合理总结wenyi 文译把全书语境翻译的思路压缩进一条命令为字幕场景提供了快速、可续跑、可对照的 SRT 翻译工作流滑窗批量 高并发保证速度批次缓存保证中断零损失双语对照方便成片校对。无论是几十条的短片还是上万条的剧集uv run wenyi translate movie.srt --bilingual都能让你快速拿到可直接使用的成品字幕。更多细节可参考 docs/zh/usage.md 与 docs/zh/configuration.md。【免费下载链接】wenyi将被语言阻隔的作品带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/gh_mirrors/we/wenyi创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

云计算运维实战:从基础概念到云覆盖度计算与免费资源 2026/10/2 18:25:53

云计算运维实战:从基础概念到云覆盖度计算与免费资源

1. 先把"云计算"这三个字翻译成人话干云计算这行快五年了,我笔记本里存得最多的不是某个命令怎么敲,而是各种"想当然"被现实打脸的记录。前阵子重读这些笔记,发现一个规律:真正值钱的不是记了多少概念&#x…

阅读更多 →
Linux多路转接:从非阻塞IO到epoll高效模型 2026/10/2 18:25:53

Linux多路转接:从非阻塞IO到epoll高效模型

要聊Linux的多路转接,绕不开非阻塞IO、轮询机制这两条主线。很多写网络服务的同学,一开始接触socket编程都是阻塞模型:一个线程accept,然后阻塞在read上等数据,来一个连接开一个线程,直到并发上来才发现线程…

阅读更多 →
模型Hub:AI工程化的操作系统与落地实践指南 2026/10/2 18:25:27

模型Hub:AI工程化的操作系统与落地实践指南

1. 这不是“模型商店”,而是一套支撑AI工程化的底层操作系统你打开Hugging Face,搜一个“bert-base-chinese”,点几下就下载下来跑起来了——这背后没有魔法,只有一整套精密运转的模型分发、验证、协作与演进机制。模型 Hub这个词…

阅读更多 →
3-RRR并联机器人运动学建模与MATLAB仿真 2026/10/2 18:25:27

3-RRR并联机器人运动学建模与MATLAB仿真

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

阅读更多 →
实时云渲染选型实战:GPU、编码与网络链路全解析 2026/10/2 18:25:21

实时云渲染选型实战:GPU、编码与网络链路全解析

实时云渲染这个词,这两年几乎被说烂了。云游戏、云设计评审、云端数字孪生、建筑可视化、汽车配置器,到处都在谈"渲染上云"。但真正动手做过选型的人都知道,这事水很深。很多团队拿着厂商PPT上"4K 60帧、毫秒级延迟"的参…

阅读更多 →
读懂2024金融级分布式数据库市场报告:选型与POC避坑指南 2026/10/2 18:25:21

读懂2024金融级分布式数据库市场报告:选型与POC避坑指南

简介:《2024年中国金融级分布式数据库市场跟踪报告》由沙利文联合头豹研究院发布,面向金融行业决策者、数据库厂商、政策研究者及投资机构,系统梳理分布式数据库在金融领域的市场格局与技术走向。报告以银行、保险、证券等金融机构的调研为基…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞 ✉