新闻详情

新闻详情

首页 / 资讯中心 / 详情

srt-whiteboard-animation如何智能拆分SRT分镜?25-35秒场景切分算法解析

发布时间:2026/9/28 21:17:42来源:尧图网络
srt-whiteboard-animation如何智能拆分SRT分镜?25-35秒场景切分算法解析
srt-whiteboard-animation如何智能拆分SRT分镜25-35秒场景切分算法解析【免费下载链接】srt-whiteboard-animation将 SRT 字幕做成暖米黄纸张底的流式笔迹白板手绘动画 skillmask 分区遮罩编排 stream 连续笔迹ink→color。项目地址: https://gitcode.com/gh_mirrors/sr/srt-whiteboard-animationsrt-whiteboard-animation是一个把 SRT 字幕转成暖米黄纸张底白板手绘动画的开源 Skill。它的起点不是画图而是智能拆分 SRT 分镜先把字幕解析成结构化字幕条再按每幕 25–35 秒口播的规则自动聚合成场景给出每幕的起止时间、总时长sceneDurationMs和台词文本——这就是后面逐幕生成线稿、标注和 MP4 的全部依据。为什么是 25–35 秒的场景时长做白板手绘动画时每一幕通常只表达一个核心意思太短25 秒画面刚铺陈完叙事就断了渲染出来的片段节奏急促太长35 秒单张线稿要承载过多事件分区遮罩和笔迹顺序容易混乱落在25–35 秒目标 30 秒口播节奏自然一幕一张图、一图一段完整叙事最适合字幕驱动、逐步确认的工作流。这套时长规则直接决定了每张场景图的sceneDurationMs也就是该幕渲染成片的总时长。第一步容错式 SRT 字幕解析分镜的前提是把.srt文件读干净。parse_srt.py 的解析函数对常见脏数据做了容错容忍BOM 头、\r\n/\r换行差异和多余空行毫秒分隔符同时支持逗号和小数点00:00:12,000与00:00:12.000按包含--的时间轴行定位每条字幕时间自动换算为毫秒输出统一的字幕条结构{index, startMs, endMs, durMs, text}。这样无论字幕来自哪台电脑、哪个剪辑软件导出的都能稳定得到同一份结构化数据。核心算法贪心累积 三重时长约束场景切分由 group_scenes 函数完成逻辑非常直观——贪心累积到点断幕逐条累积按顺序把字幕条塞进当前幕的桶里强制上限若再并入下一条会超过max默认 35 秒先断幕目标断幕当前幕跨度达到target默认 30 秒且不短于min默认 25 秒时立即断幕遍历结束后把剩余的尾巴 flush 成最后一幕。每个场景输出如下字段直接供后续流程消费{ sceneIndex: 1, startMs: 300, endMs: 30600, sceneDurationMs: 30300, cueRange: [1, 8], text: 小猴坐在猴子山顶…… } 算法的关键在用跨幕跨度而非累加时长来判断断点span 本幕最后一条字幕的 endMs − 第一条字幕的 startMs天然把字幕间的静默空隙算进时长断幕更贴近真实口播节奏。分镜结果如何被下游消费parse_srt.py的输出是整条工作流的第一步依据详见 SKILL.md 的工作流章节配图策略每个场景对应一张 16:9 线稿sceneDurationMs写入标注文件成为该幕 MP4 的总时长语义标注场景文本被拆成叙事事件逐元素填入annotation.json的subtitle与narrativeRole可参考 scene-01-monkey-mountain-banana.annotation.json 中的场景铺垫 → 动作冲突 → 反应结果顺序渲染时长渲染器缺省直接读取标注里的sceneDurationMs无需手动传时长。快速上手一条命令拿到分镜建议python scripts/parse_srt.py 字幕.srt --target-sec 30 --min-sec 25 --max-sec 35参数都可在 parse_srt.py 中查看默认值。运行后stderr打印人类可读摘要字幕条数、总时长、每幕的区间和台词预览方便快速核对stdout输出完整 JSONcuesscenes可直接落盘作为后续步骤的输入。如果分镜粒度不合预期只需调整--target-sec / --min-sec / --max-sec三个参数重跑即可算法本身保持稳定。相关模块索引分镜算法源码scripts/parse_srt.py完整工作流与约束SKILL.md项目说明与命令速查README.md流式笔迹渲染器scripts/render_stream_whiteboard.py多幕合并scripts/merge_scenes.py标注预览台assets/preview.html小结srt-whiteboard-animation 的 SRT 分镜拆分 容错解析 贪心断幕25–35 秒的三重时长约束默认 30/25/35保证每一幕口播节奏舒适、一图一叙事输出的sceneDurationMs一路贯穿到标注与渲染让字幕 → 分镜 → 线稿 → 成片的整条链路都严格对齐口播时间轴。这正是白板动画看着顺的关键所在。【免费下载链接】srt-whiteboard-animation将 SRT 字幕做成暖米黄纸张底的流式笔迹白板手绘动画 skillmask 分区遮罩编排 stream 连续笔迹ink→color。项目地址: https://gitcode.com/gh_mirrors/sr/srt-whiteboard-animation创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

中文微博情感分析实战:LSTM三分类模型与工业级预处理链路 2026/9/28 22:08:36

中文微博情感分析实战:LSTM三分类模型与工业级预处理链路

简介:本资源是一份面向高校人工智能课程设计与深度学习实践者的Python三分类文本情感分析完整项目,基于LSTM模型实现正面、中性、负面情感判别,适用于课程大作业、毕设基础模块或NLP入门实战。压缩包共15个文件,包含3个CSV标注数据…

阅读更多 →
从Agent Framework到Agent Harness:智能体稳定落地的关键跃迁 2026/9/28 22:08:29

从Agent Framework到Agent Harness:智能体稳定落地的关键跃迁

“模型已经够聪明了,框架也遍地都是,可我们的 Agent 项目还是推不进生产。”这是我过去半年被客户问到最多的一句话。从 2023 年到 2025 年,Agent Framework 层出不穷,LangChain、AutoGen、MetaGPT、CrewAI 轮番刷屏,每…

阅读更多 →
Substrate是区块链操作系统内核,不是开发框架 2026/9/28 22:08:08

Substrate是区块链操作系统内核,不是开发框架

1. 项目概述:Substrate不是“框架”,而是区块链的“操作系统内核”你搜“substrate”,十有八九会看到一堆“Substrate是Polkadot的底层框架”“Substrate是Rust写的区块链开发框架”这类说法。但从业十年、亲手用Substrate搭过7条链、参与过3…

阅读更多 →
从“能聊代码”到“能干活”:AI编码助手XiheAgent的调度执行与告警实战 2026/9/28 22:08:02

从“能聊代码”到“能干活”:AI编码助手XiheAgent的调度执行与告警实战

去年下半年开始,我一直在琢磨一个问题:市面上的AI编码助手大部分都在解决“代码问答”,你问它一段代码是什么意思、哪里可能出bug、要怎么改,它能给你讲得明明白白。可一问到“帮我把这个任务跑起来”“数据同步失败了帮我查一下怎…

阅读更多 →
UDS多帧传输避坑指南:STmin与BS参数详解及调试技巧 2026/9/28 22:08:02

UDS多帧传输避坑指南:STmin与BS参数详解及调试技巧

1. 为什么多帧传输是UDS诊断里最容易翻车的一环搞过UDS诊断的人都有一个共识:单帧收发的诊断服务(比如会话控制、读取故障码)基本不会出问题,真正让人抓耳挠腮的,永远是那些数据长度超过7个字节、必须走多帧传输的场景…

阅读更多 →
从认知匹配到行为形成:WSaiOS 中能力、知识与行为的匹配理论 2026/9/28 22:08:02

从认知匹配到行为形成:WSaiOS 中能力、知识与行为的匹配理论

从认知匹配到行为形成:WSaiOS 中能力、知识与行为的匹配理论摘要:本文系统阐述 WSaiOS 认知匹配理论中“能力—知识—行为”匹配框架。该框架回应了一个核心问题:一个方法能够被找到,并不等于认知对象能够执行它;一个行…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞 ✉