Pixelle-Video:输入一个主题,3 分钟出片 AI 短视频
Pixelle-Video输入一个主题3 分钟出片 AI 短视频【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video一条 60 秒的竖屏科普视频从输入如何提升工作效率到 MP4 落盘全程 3–5 分钟中间不打开任何剪辑软件、不录一次音轨。这是 Pixelle-Video 做到的事一个开源的 AI 短视频生成引擎输入一句话主题自动产出带旁白、配图、字幕和背景音乐的完整成片。 它到底能做什么你只负责给主题或贴一段现成文案剩下的环节它全包了写稿LLM 按分镜数生成结构化旁白每段 5–20 字天然适配一句话配一帧的节奏配图逐帧调用 FLUX、SDXL、Qwen、Wan 等图像/视频模型或走 ComfyUI 工作流配音Edge-TTS 或 Index-TTS支持上传参考音频做声音克隆合成HTML 模板排版文字与画面ffmpeg 拼接片段、叠加 BGM输出 MP4。传统流程 vs 本项目环节传统做法Pixelle-Video脚本 分镜手动写稿切段一次生成默认 5 段素材找图 / 拍图AI 逐帧生成剪辑时间轴拖拽按音频时长自动对齐 3 分钟跑通最小可用流程克隆仓库并进入目录git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video启动 Web 界面需先装好 uv 和 ffmpeguv run streamlit run web/app.py浏览器打开 http://localhost:8501。首次进入展开「⚙️ 系统配置」面板只填两处就够LLM选通义千问或 DeepSeek 预设填 API Key图像工作流默认走runninghub/image_flux.json填一个 RunningHub Key 即可不用本地部署 ComfyUI。其余 TTS、模板、BGM 保持默认。左侧输入主题右侧点「 生成视频」进度条会实时显示分镜 3/5 - 生成插图几分钟内右侧就出现可播放的成片文件落在output/目录。⚙️ 核心机制拆解一条流水线是怎么跑通的整条流水线在 pixelle_video/pipelines/standard.py 里可以拆成四段。主题到分镜让 LLM 替你切节奏输入为什么我们还没找到外星文明系统先调 LLM 生成标题再按n_scenes5拆出 5 段旁白每段限制在min_narration_words5到max_narration_words20之间——这是刻意压短因为每一段都会对应一帧画面太长会把单帧时长拖垮。如果你走固定文案模式系统按段落、行或句子三种方式切分split_mode参数适合已有完整稿子的场景。音画同步先合成语音再生成画面这是整个项目最反直觉的设计。每一帧的处理顺序是TTS 先跑 → 拿到音频时长 → 把时长传给视频生成工作流。也就是说Wan 2.1 生成的片段时长是被旁白锁死的拼接时不用补帧也不用裁尾音画天然对齐。你最终听到的是一段语速均匀、切镜点精确卡在句尾的解说不会出现画面还在动、声音已经停了的空档。HTML 模板把画面排版成模板化成品templates/目录里有 30 个 HTML 模板按static_/image_/video_三种前缀区分是否需要 AI 生成媒体。渲染时系统把 AI 配图、标题、旁白文字、品牌角标按模板的 CSS 排版成一帧截图再合成视频。同一句AI 改变内容创作切到极简模板就是白底细线的杂志感切到 film 模板就是黑底衬线字加留白。模板即风格改 CSS 就能出品牌视觉。ffmpeg 收尾拼接 BGM 一次完成VideoService用 ffmpeg 把 N 个片段串成一条音频轨合并旁白与bgm/目录里的背景音乐音量自动归一。你拿到的是一个 1080×1920、可直接发抖音的 MP4。 实战一条为什么还没找到外星文明走完全流程输入左侧选「AI 生成内容」主题栏填为什么我们还没有找到外星文明分镜数保持默认 5语音中间栏 TTS 工作流选selfhost/tts_edge.json音色选zh-CN-YunxiNeural男声偏解说点「预览语音」先听 3 秒视觉图像工作流选runninghub/image_flux.json提示词前缀填Cinematic, moody, deep space, minimalist英文模板选1920x1080/image_film.html尺寸 1920×1080BGM选内置default.mp3试听确认不抢人声生成点「 生成视频」右侧进度依次显示生成文案 → 分镜 1/5 插图 → 分镜 1/5 语音 → …全程 3 分 40 秒左右微调第一版旁白第 3 段太书面切到固定文案模式贴入改写稿重新生成或保留文案、把模板换成image_ultrawide_minimal.html再跑一遍只动视觉层。其他场景如数字人口播、图生视频、动作迁移都在 web/pipelines/ 下以独立流水线提供切换方式相同。 进阶批量、模板与参数批量生成内容输入区切到批量模式每行一个主题任务队列自动排队适合做系列或日更模板定制所有模板在 templates/ 下改 CSS 变量即可换主色、字号、品牌 Logo无需碰 Python 代码工作流扩展把 ComfyUI 导出的 JSON 丢进 workflows/重启后自动出现在下拉菜单支持本地 selfhost 与云端 runninghub 两套目录参数调优n_scenes控制分镜数3–8 之间tts_speed调语速0.8–1.2 最自然prompt_prefix是全局画风锚点改动一次影响所有分镜。❓ 新手最容易卡住的 4 个问题Q生成卡在生成配图不动A先查 RunningHub 配额是否耗尽再查comfyui.comfyui_url是否可达本地模式最后看终端日志里 prompt 是否被内容审核拦截。Q旁白听起来机械、和画面不同步A同步问题查 TTS 工作流是否返回了duration机械感先换音色再调tts_speed0.9仍不行就上 Index-TTS 传参考音频克隆。Q图片风格跑偏跟提示词前缀对不上A先确认prompt_prefix是英文再看图像模型是否支持你给的分辨率换selfhost/image_flux.json与runninghub/image_flux.json对比即可定位是模型问题还是参数问题。QWindows 上 ffmpeg 报错A先跑ffmpeg -version确认在 PATH 里整合包已内置源码安装需把bin目录加入环境变量。 把仓库拉下来跑通第一条配置模板见 config.example.yaml界面细节查 docs/zh/user-guide/web-ui.md扩展能力看 workflows/ 目录。今晚把主题贴进去明早你的账号上就多一条 60 秒成片。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

IBM智能工厂顶层架构设计:ISA-95、CBM与白酒全流程系统集成

IBM智能工厂顶层架构设计:ISA-95、CBM与白酒全流程系统集成

简介:这份PPT面向制造企业信息化负责人、智能制造咨询顾问及工厂数字化规划人员,聚焦智能工厂信息化顶层架构设计这一咨询项目全貌。内容以白酒行业酿酒工程技改项目为背景,从企业战略与业务需求出发,梳理承上启下的IT战略规划关系…

2026/9/18 23:24:08 阅读更多 →
基于价值认同的分布式能源交易策略与Matlab实现

基于价值认同的分布式能源交易策略与Matlab实现

1. 项目背景与核心价值去年参与某园区微电网项目时,遇到一个典型难题:光伏用户午间发电过剩,而隔壁工厂却因用电高峰支付着高昂电费。这种供需错配现象在分布式能源场景中极为常见。传统解决方案往往依赖中心化调度或固定电价机制&#xff0c…

2026/9/18 23:24:08 阅读更多 →
用 BabelDOC 一条命令保留排版完成 PDF 中英互译

用 BabelDOC 一条命令保留排版完成 PDF 中英互译

用 BabelDOC 一条命令保留排版完成 PDF 中英互译 【免费下载链接】BabelDOC Yet Another Document Translator 项目地址: https://gitcode.com/GitHub_Trending/ba/BabelDOC BabelDOC 是一个开源的 PDF 智能翻译工具,能把英文论文、技术文档翻译成中文&#…

2026/9/18 23:23:08 阅读更多 →

最新新闻

Postman批量发送请求最佳实践:从数据驱动到CI集成全攻略

Postman批量发送请求最佳实践:从数据驱动到CI集成全攻略

直接用 Postman 发单个请求,是大多数接口调试场景里的日常操作。可一旦变成需要验证 50 个用户的订单状态、给 30 个不同参数的商品详情接口做回归、或者把一批线上数据拿回来重新造数,鼠标点到手酸不说,还特别容易漏掉中间某一条。这时候真正…

2026/9/19 0:16:43 阅读更多 →
从古法编程到现代交付:自评模型与8-12周转行路线

从古法编程到现代交付:自评模型与8-12周转行路线

前两天在一个老同事群里,有人甩了张截图,配文是"2026年了还手写一整个CRUD,这不就是古法编程哥本人"。群里笑成一片,笑完之后有个人说了句实话:我们组今年新招的两个年轻人,一个人一周出的活比我…

2026/9/19 0:16:43 阅读更多 →
YuE模型:AR-NAR混合架构的Python原生长序列生成方案

YuE模型:AR-NAR混合架构的Python原生长序列生成方案

1. “YuE”到底是什么?一个被热搜带偏但技术含量十足的AI模型项目最近在Hugging Face社区和Python技术圈里,“YuE”这个词突然密集出现,搭配着“YuE2”“AR–NAR Mixture-of-Transformers”这些术语,让不少刚入门的朋友一头雾水—…

2026/9/19 0:16:43 阅读更多 →
VRPTW问题求解:混合遗传算法在物流配送中的实践

VRPTW问题求解:混合遗传算法在物流配送中的实践

1. 项目背景与核心价值VRPTW(Vehicle Routing Problem with Time Windows)是物流配送领域经典的优化问题。简单来说,就是如何在满足客户时间窗约束的前提下,用最少的车辆完成所有配送任务。这个问题在电商配送、外卖调度、冷链物流…

2026/9/19 0:16:43 阅读更多 →
使用 Terraform AWS Provider 的 aws_identitystore_group_memberships 数据源查询 IAM Identity Center 群组成员列表

使用 Terraform AWS Provider 的 aws_identitystore_group_memberships 数据源查询 IAM Identity Center 群组成员列表

使用 Terraform AWS Provider 的 aws_identitystore_group_memberships 数据源查询 IAM Identity Center 群组成员列表 【免费下载链接】terraform-provider-aws The AWS Provider enables Terraform to manage AWS resources. 项目地址: https://gitcode.com/GitHub_Trendin…

2026/9/19 0:16:43 阅读更多 →
PyTorch实现UNet图像分割:Shape对齐与卷积递推详解

PyTorch实现UNet图像分割:Shape对齐与卷积递推详解

简介:这是一份面向图像分割入门者的Unet网络PyTorch实现资料,主要解决“想看懂Unet结构却不知如何下手”的问题。内容围绕U形对称架构展开:左侧通过卷积与最大池化逐级下采样以提取高层语义特征,右侧利用最近邻上采样与跳跃连接逐…

2026/9/19 0:15:43 阅读更多 →

日新闻

BP神经网络时序预测:滑窗长度与多窗口平均策略

BP神经网络时序预测:滑窗长度与多窗口平均策略

简介:面向机器学习、深度学习与数据建模学习者的一份完整研究文献,聚焦BP神经网络在农业产量预测中的应用。文档以1980—2018年全国棉花产量为样本,系统讲解数据归一化处理、激活函数原理、多层神经网络结构搭建及训练流程,展示敏…

2026/9/19 0:00:30 阅读更多 →
Transformer训练实时监控实战:基于MindSpore的损失曲线可视化方案

Transformer训练实时监控实战:基于MindSpore的损失曲线可视化方案

上个月调一个Deformable DETR模型,在单卡上要跑将近两天。第二天早上我下意识打开终端翻日志,发现loss从凌晨两点就开始往上爬,一路从0.8涨到1.35,整整六个小时没人发现。那六个小时的训练不仅白跑,还霸占着卡——等于…

2026/9/19 0:00:30 阅读更多 →
OpenCloud 中的 Go 类型安全转换库 spf13/cast:从零值回退到泛型 API 的完整实战指南

OpenCloud 中的 Go 类型安全转换库 spf13/cast:从零值回退到泛型 API 的完整实战指南

OpenCloud 中的 Go 类型安全转换库 spf13/cast:从零值回退到泛型 API 的完整实战指南 【免费下载链接】opencloud 🌤️ OpenCloud is the open source platform for file management, sharing and collaboration. Simple and sovereign. 项目地址: htt…

2026/9/19 0:00:30 阅读更多 →

周新闻

AI SDK Harness 依赖更新指南:掌握 harness 包 SDK 依赖的升级、桥接同步与一致性校验

AI SDK Harness 依赖更新指南:掌握 harness 包 SDK 依赖的升级、桥接同步与一致性校验

AI SDK Harness 依赖更新指南:掌握 harness 包 SDK 依赖的升级、桥接同步与一致性校验 【免费下载链接】ai The AI Toolkit for TypeScript. From the creators of Next.js, the AI SDK is a free open-source library for building AI-powered applications and ag…

2026/9/16 19:03:19 阅读更多 →
Refine v5 Ant Design NumberField 组件实战:基于 Intl 的本地化数字格式化

Refine v5 Ant Design NumberField 组件实战:基于 Intl 的本地化数字格式化

Refine v5 Ant Design NumberField 组件实战:基于 Intl 的本地化数字格式化 【免费下载链接】refine A React Framework for building internal tools, admin panels, dashboards & B2B apps with unmatched flexibility. 项目地址: https://gitcode.com/GitH…

2026/9/17 7:57:36 阅读更多 →
Flutter应用改名全指南:从Android到iOS的配置与工具实践

Flutter应用改名全指南:从Android到iOS的配置与工具实践

刚接一个外包项目时,甲方要求把工程里临时用的应用名改成正式产品名。我本来觉得“改名”这种小事,打开配置文件改一行不就完了?结果真动手才发现,Flutter项目里“应用名称”根本不是一处配置,而是一整套散落在 Androi…

2026/9/17 10:19:14 阅读更多 →

月新闻

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能分类:[AI/大模型]细分主题:AI 增强型 CI/CD 流水线自动化与 GitOps 实践:Agent 工作流、工具调用与任务拆解:从原型到生产的验收清单很多团队在尝试用大…

2026/9/16 22:31:27 阅读更多 →
容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场分类:[工程技术]细分主题:Kubernetes 生产环境运维与排障实战:可复制的项目复盘模板与决策记录大部分团队的事故复盘报告,最后都变成了躺在 Confluence 或钉…

2026/9/15 21:39:18 阅读更多 →
容器 容器化技术与镜像安全管理:核心链路应该先拆哪一步

容器 容器化技术与镜像安全管理:核心链路应该先拆哪一步

容器 容器化技术与镜像安全管理:核心链路应该先拆哪一步分类:[工程技术]细分主题:Docker 容器化技术与镜像安全管理:核心链路的逐步实现与关键代码取舍面对一个积累了五六年历史包袱的单体架构应用(包含 Web 接口、后台…

2026/9/16 22:32:59 阅读更多 →