wenyi文译SRT字幕翻译:电影字幕快速译出,支持双语对照与断点续跑的完整指南
wenyi文译SRT字幕翻译电影字幕快速译出支持双语对照与断点续跑的完整指南【免费下载链接】wenyi将被语言阻隔的作品带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/gh_mirrors/we/wenyi使用wenyi 文译做 SRT 字幕翻译只需一条命令即可把电影、剧集的.srt字幕快速译出为目标语言支持--bilingual生成双语对照字幕中断后重新执行同一命令即可断点续跑已完成的批次不会重复消耗 Token。字幕路径采用滑窗批量 高并发调用速度远快于逐条翻译且状态文件轻量、开箱即用。为什么用 wenyi 翻译字幕更省心市面上很多字幕翻译脚本一次性翻译中断即作废长片动辄上万条字幕中途网络波动就得全部重来。wenyi 文译把书籍翻译中成熟的批次检查点机制搬到了字幕场景⚡滑窗并发每次批量处理 20 条字幕、相邻批次重叠 10 条保持语境连贯最多 100 路并发调用 strong 档模型断点续跑已完成的批次缓存在state/srt/slug/targets/目标语言/batches/再次运行自动跳过双语对照--bilingual一键生成原文译文对照的.zh-bi.srt方便对照校对轻量路径不建术语库、不跑全书审校专注快速出片无需额外配置。快速开始一条命令译出电影字幕先在项目文档中查看 中文使用说明配置好模型后translate命令会按扩展名自动把.srt分流到字幕管线uv run wenyi translate movie.srt # 默认输出单语 output/movie.zh.srt uv run wenyi translate movie.srt --bilingual # 同时生成双语对照 movie.zh-bi.srt uv run wenyi translate movie.srt --no-mono --bilingual # 只出双语版翻译完成后终端会打印译出条数、总条数、Token 用量与耗时统计产物默认落在源文件旁的output/目录。字幕路径不支持--chapter、--format等书籍选项传入时会明确报错提示。断点续跑中断后如何无缝恢复长电影字幕翻译动辄几十分钟遇到断网、限流或手动停止都很正常。wenyi 的做法很直接——再次对同一源文件执行同一命令即可续跑每次成功翻译的批次会写入batches/缓存下次运行直接复用不再请求模型cues.jsonl逐条记录每条字幕的index / timestamp / source / target / status恢复时从状态文件重建进度usage.json跨续跑累计 Tokenevents.jsonl追加记录运行事件与重试方便事后对账。状态目录布局如下全部为纯文本文件可读可检查state/srt/slug/targets/目标语言/ manifest.json # 源文件身份SHA-256、字幕条数、滑窗配置 cues.jsonl # 每条字幕的译文与完成状态 batches/ # 模型原始批次结果供续跑 usage.json # 跨 resume 累计 token timing.json # 累计执行时长 events.jsonl # 运行事件与 LLM 重试观察 提示manifest 会校验源文件 SHA-256若你修改了字幕源文件再续跑会提示使用独立状态目录避免新旧状态混用。双语对照与单语输出怎么选输出控制有两种开关默认只出单语版单语版output/文件名.zh.srt纯译文直接挂到播放器即可双语版加--bilingual生成文件名.zh-bi.srt每条字幕译文一行 原文一行适合教学、校对场景。输出偏好也可以在 配置文件说明 中通过output.mono与output.bilingual持久设置命令行参数优先。字幕翻译走srt.translate操作路由默认使用strong档模型可在llm.routes中单独调整不影响书籍管线配置。字幕管线的实现原理简述字幕翻译的核心逻辑位于 srt/translate.py状态管理在 srt/store.py读取与写盘分别由 srt_reader.py 和 srt_writer.py 负责批量 JSON 翻译模型以 JSON 形式一次性返回整批字幕译文失败批次自动重试 3 次单条兜底批量仍未覆盖的缺失条目会并发逐条补译仍失败则保留原文保证产物完整原子落盘cues 写入采用临时文件 原子替换进程锁串行化并发写异常中断也不会损坏状态文件用量可审计每次批次完成即增量合并 Token 用量即使中途打断也会落盘不会白算。上手检查清单translate movie.srt单语输出是否正常生成于output/--bilingual双语版逐条是否译文在上、原文在下翻译中途 CtrlC 后重跑是否跳过已缓存批次、Token 无重复消耗state/srt/下usage.json、events.jsonl是否有累计记录长片大字幕是否按预期并发跑完终端耗时统计是否合理总结wenyi 文译把全书语境翻译的思路压缩进一条命令为字幕场景提供了快速、可续跑、可对照的 SRT 翻译工作流滑窗批量 高并发保证速度批次缓存保证中断零损失双语对照方便成片校对。无论是几十条的短片还是上万条的剧集uv run wenyi translate movie.srt --bilingual都能让你快速拿到可直接使用的成品字幕。更多细节可参考 docs/zh/usage.md 与 docs/zh/configuration.md。【免费下载链接】wenyi将被语言阻隔的作品带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/gh_mirrors/we/wenyi创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

配置禁止重定向,为何请求仍继续?Axios Fetch 适配器的安全契约

配置禁止重定向,为何请求仍继续?Axios Fetch 适配器的安全契约

配置禁止重定向,为何请求仍继续?Axios Fetch 适配器的安全契约 一、背景与时间线 官方确认Fetch适配器未执行maxRedirects限制,底层默认跟随跳转;HTTP适配器不受这一具体问题影响。利用需要可控跳转源及依赖该配置的应用&#x…

2026/10/2 17:32:45 阅读更多 →
深度 | 谷歌Gemini 4 Argon单次输出100万Token:长输出是智能体刚需,先给防御者不给攻击者才是新玩法

深度 | 谷歌Gemini 4 Argon单次输出100万Token:长输出是智能体刚需,先给防御者不给攻击者才是新玩法

谷歌发布 Gemini 4 Argon,单次输出上限从 6.4 万 Token 拉到 100 万。 我判断,这条新闻的分量不在又发了个旗舰,在于它把一个被忽视的指标——输出上限——推到台前。而且谷歌做了 OpenAI 没做的选择:因为 Argon 漏洞发现能力太强…

2026/10/2 17:32:45 阅读更多 →
济南海尔集团家用电器购买品牌企业实力参考

济南海尔集团家用电器购买品牌企业实力参考

济南买大件家电怎么选?海尔集团全流程服务体系一文讲透选购空调、冰箱、洗衣机、热水器、厨电、电视这类大型家电,怕尺寸不合适、安装不专业、售后没人管?济南海尔集团家用电器购买品牌企业,依托海尔集团近四十年的制造与服务积淀,为济南家…

2026/10/2 17:31:45 阅读更多 →

最新新闻

海洋目标检测数据集实战:1000张图、三套标签与划分脚本全解析

海洋目标检测数据集实战:1000张图、三套标签与划分脚本全解析

简介:本资源为面向目标检测学习者的YOLO海洋目标检测数据集,适用于需要真实场景海洋目标样本的算法训练与课程实践,可解决自建数据集标注成本高、格式转换繁琐的问题。压缩包共2000个文件,约23.38MB,包含1000张真实场景…

2026/10/2 18:01:00 阅读更多 →
EEGNET脑电分类实战:从信号预处理到可复现深度学习流水线

EEGNET脑电分类实战:从信号预处理到可复现深度学习流水线

简介:这份资源面向脑电信号处理与深度学习入门者,提供EEGNET网络的完整Python实现,用于脑电分类任务。EEGNET借鉴CNN与CRNN思想,由空间卷积层和时序卷积层组成,能同时捕捉EEG数据的空间与时间依赖特征,是生…

2026/10/2 18:01:00 阅读更多 →
EEGNET脑电分类实战:从信号预处理到模型训练与调参

EEGNET脑电分类实战:从信号预处理到模型训练与调参

简介:这份资源面向脑电信号处理与深度学习入门者,提供EEGNET网络的完整Python实现,用于脑电分类任务。EEGNET借鉴CNN与CRNN思想,由空间卷积层和时序卷积层组成,能同时捕捉EEG数据的空间与时间依赖特征,是生…

2026/10/2 18:01:00 阅读更多 →
BeanUtils.copyProperties真实行为与安全替代方案

BeanUtils.copyProperties真实行为与安全替代方案

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/2 18:01:00 阅读更多 →
编译通过但gdb无符号?ESP-IDF切换版本后必做fullclean排查

编译通过但gdb无符号?ESP-IDF切换版本后必做fullclean排查

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/2 18:01:00 阅读更多 →
OpenCV Python人脸检测教程29:用TaoToken统一Key跑通Haar与DNN两种检测方案

OpenCV Python人脸检测教程29:用TaoToken统一Key跑通Haar与DNN两种检测方案

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/2 17:59:59 阅读更多 →

日新闻

从零搭建AI工程化:模型之外的完整闭环

从零搭建AI工程化:模型之外的完整闭环

先搞清楚一件事:从零开始做 AI 工程化,难的从来不是调模型、写提示词,而是把一套原型 Demo 变成长得像是“正经系统”的东西。你手里可能已经有了能跑通的代码,也可能刚读完一些概念,但真到了要把它变成可维护、可观测…

2026/10/2 0:00:20 阅读更多 →
大模型训练显存估计与混合精度训练实战指南

大模型训练显存估计与混合精度训练实战指南

1. 大模型训练显存估计与混合精度训练详解显存不够用,几乎是每个做大模型训练的人都会撞上的第一堵墙。你可能也经历过:模型代码写完了,数据管道跑通了,满心欢喜地按下训练启动脚本,结果几秒钟后终端弹出一行红字——C…

2026/10/2 0:00:20 阅读更多 →
小样本学习数据集选型指南:27个真正可用的高质量数据集

小样本学习数据集选型指南:27个真正可用的高质量数据集

1. 小样本学习的“弹药库”:为什么你总在找数据集,却总找不到真正能用的? 小样本、数据集——这两个词最近半年在我处理的200多个AI项目咨询里,出现频率排进前三。不是模型调不好,不是代码写不对,而是卡在…

2026/10/2 0:00:20 阅读更多 →

周新闻

如何划分训练/验证集:Spirula Studio五种eval_mode策略详解

如何划分训练/验证集:Spirula Studio五种eval_mode策略详解

如何划分训练/验证集:Spirula Studio五种eval_mode策略详解 【免费下载链接】spirula-studio Cross-vendor 3D Gaussian Splatting trainer - video to splat to mesh, Vulkan or CUDA. 项目地址: https://gitcode.com/GitHub_Trending/sp/spirula-studio Sp…

2026/10/1 19:40:48 阅读更多 →
SEO怎么推广速查手册新手避坑实战指南

SEO怎么推广速查手册新手避坑实战指南

SEO怎么推广速查手册新手避坑实战指南 模板网站太丑不够用?别急着加滤镜,那是治标不治本。很多老板盯着后台流量掉得眼红,却还在纠结首页Banner的圆角是不是3像素。这就像穿着西装去挖土,姿势不对,努力白费。我整理这份 速查手册…

2026/10/1 19:41:40 阅读更多 →
FireRed-OpenStoryline少样本仿写深度解析:AI Agent如何复刻你的独特文案风格与节奏

FireRed-OpenStoryline少样本仿写深度解析:AI Agent如何复刻你的独特文案风格与节奏

FireRed-OpenStoryline少样本仿写深度解析:AI Agent如何复刻你的独特文案风格与节奏 【免费下载链接】FireRed-OpenStoryline FireRed-OpenStoryline is an AI video editing agent that transforms manual editing into intention-driven directing through natural language …

2026/10/1 20:05:24 阅读更多 →

月新闻

我发现了一个新思路:用 Remotion + Claude Code 像写代码一样自动化生成短视频

我发现了一个新思路:用 Remotion + Claude Code 像写代码一样自动化生成短视频

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/2 10:36:31 阅读更多 →
Windows下 Codex 中 Chrome 和 Computer Use 插件不可用问题排查及解决参考方式:TaoToken 统一 Key 配置与验证

Windows下 Codex 中 Chrome 和 Computer Use 插件不可用问题排查及解决参考方式:TaoToken 统一 Key 配置与验证

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/2 5:26:06 阅读更多 →
黑夜航拍船只数据集训练YOLOV5模型全流程解析

黑夜航拍船只数据集训练YOLOV5模型全流程解析

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/2 6:09:11 阅读更多 →