首页
/
行业洞察
/
正文
INDUSTRY INSIGHT · 深度
Pixelle-Video:输入一个主题,几分钟产出 AI 短视频成片
📅 2026/9/18 2:29:56
✍️ 爱科研究院
👁 阅读 3,247
Pixelle-Video输入一个主题几分钟产出 AI 短视频成片【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-VideoPixelle-Video 是一个开源的 AI 短视频生成引擎定位在一句话出片你在界面上输入一句主题它会自动完成文案撰写、逐句配图或配视频、合成语音解说、加上背景音乐最后拼成一条带旁白和画面的 MP4 成片。它把过去要分别做脚本、找素材、录配音、剪辑的环节合并成一次点选主要面向没有剪辑基础、但想持续产短视频的内容创作者。 从一句话到成片整条流水线怎么走把 Pixelle-Video 理解成一条流水线会比记功能点更清楚。你给的主题先进入文案环节由 LLM 写出带节奏的解说词并默认拆成 5 个分镜接着每个分镜都会调用图像或视频模型生成一张配图或一段动态画面随后 TTS 按文案合成旁白BGM 铺底最后系统把这些分镜、画面、音轨按模板版式合成为一条完整视频存到output/目录并自动播放预览。关键点在于每一步都可替换文案用什么大模型、配图用哪个工作流、配音用哪种 TTS彼此独立可以单独换掉某一步而不影响其他环节这也是它支持多种供应商共存的原因。⚙️ 跑通最小闭环从环境到第一条成片先装好两个前置工具uvPython 包管理器和ffmpeg音视频处理系统要求 Python 3.10 及以上Windows 用户则可以直接下官方整合包省去这两步。源码方式克隆后启动 Web 界面git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video ./start_web.sh启动后浏览器会打开http://localhost:8501。首次进入要展开「系统配置」面板最少填两项一是 LLM 的 API Key通义千问、GPT、DeepSeek、Ollama 都有预设选好后会自动填好 base_url 和 model二是图像生成服务——配一个本地 ComfyUI 地址或 RunningHub 的 Key对应的工作流默认指向runninghub/image_flux.json。填完点「保存配置」。然后在左侧选「AI 生成内容」输入一句主题右侧点「生成视频」。界面上会滚动显示生成文案 → 生成配图 → 合成语音 → 合成视频的进度5 分镜的一条成片通常两三分钟出结果完事右侧直接播放文件落在output/里。 能力深挖四个最值得上手的部分智能文案与固定文案分割。一句话概括它既能自己写稿也能让你贴现成文案。适合已有稿件、不想让 AI 重写的人。关键用法是「固定文案内容」模式下的分割方式——按段落、按行、按句子拆成分镜句子级最细、最贴近一句一画面长文配长解说时用它更稳。AI 配图与配视频。一句话概括每个分镜都能生成静态图或动态视频片段。适合想要画面动起来的账号。关键参数有两个prompt_prefix提示词前缀必须是英文用来统一整套配图的画风和图像尺寸默认 1024x1024不同模型对尺寸有各自上限换模型前先确认。声音克隆 TTS。一句话概括除了 Edge-TTS 这类标准音色还能上传一段参考音频让合成音更像指定的人。适合固定 IP 口播、想做个人化音色的创作者。关键用法是选择支持克隆的 TTS 工作流如 Index-TTS上传 MP3/WAV 参考音频后先「预览语音」试听再进正式生成避免克隆效果不合预期时浪费整条片子的渲染时间。模板体系。一句话概括成片版式由templates/下的 HTML 模板决定按尺寸分成竖屏 1080x1920、横屏 1920x1080、方形 1080x1080 三组。适合想统一账号视觉的运营者。命名前缀就标明了素材依赖static_纯文字不生成媒体、image_用 AI 配图、video_用 AI 配视频选模板时先看前缀再挑样式能省掉一次试错。 场景落地两条常见路径做科普/知识类竖屏号。处境是有现成知识点、要发抖音快手。操作路径是切「固定文案内容」把整理好的知识稿贴进去按句子分割成多分镜视觉选一个image_横竖屏都够用的模板TTS 用一个清晰的教学音色。产出是一条结构规整、一句一图的口播式科普短片适合批量做系列。做电商/产品横屏介绍。处境是要把卖点讲清楚、画面要大气。操作路径是选横屏 1920x1080 的image_film一类电影感模板在主题描述里塞进产品关键词和核心卖点BGM 换一支节奏稍强的内置音乐配音选偏专业的音色。产出是一条带品牌调性、适合 B 站或视频号的横版介绍片。 进阶避坑想调什么就去改哪里想调什么改哪里 / 怎么改一次出多条视频内容输入里切批量模式逐行给主题配合历史页保存成功配置换整套画面画风图像设置里的prompt_prefix英文提示词前缀配「预览风格」先试一张固定分镜的拆法固定文案模式下的段落 / 行 / 句子分割方式画面版式或加品牌元素直接改templates/里对应 HTML 的样式、背景与布局压低生成成本LLM 换 Ollama 本地 ComfyUI 本地部署可 0 元跑或通义千问这类低成本云端语音更像自己上传参考音频走声音克隆选支持克隆的 TTS 工作流批量前建议先单跑一条样本确认画风和音色再放开批量避免一整批返工RunningHub 云端有并发限制默认 1别盲目拉高。❓ 高频问题第一次生成大概要等多久主要取决于分镜数、网络和各步推理速度5 分镜的一条片普遍两三分钟内出分镜多或走云端模型会更久。配图风格不对、画面跑偏怎么调优先改英文prompt_prefix和图像尺寸再换一个图像工作流文案跑偏则换 LLM 模型或改成分镜分割更细的方式。不花钱能不能跑起来能。LLM 用 Ollama 本地、配图视频 TTS 全走本地 ComfyUI就是完全免费方案有 6GB 以上显存的显卡体验最顺。最小启动清单装好uv、ffmpeg或 Windows 直接下整合包。克隆仓库并./start_web.sh或双击start_web.bat启动浏览器打开http://localhost:8501。在「系统配置」填 LLM Key 与图像服务ComfyUI 地址或 RunningHub Key点保存。选「AI 生成内容」输入主题挑好模板与 TTS点「生成视频」。成片在output/里不满意按上面的避坑表调参重跑。参考文档docs/zh/user-guide/web-ui.md配置样例config.example.yaml现成工作流示例workflows/runninghub/。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
📌 标签:
工业官网
设计趋势
AI 建站
SEO
获取完整报告 →
RELATED ARTICLES
推荐阅读
2026/9/18 2:29:56
理解Memory Hierarchy与Cache:从局部性原理到系统性能优化
2026/9/18 2:24:56
以太网采集单元设计实战:从硬件选型到协议栈移植全解析
2026/9/18 2:24:56
本地部署DeepSeek:Ollama与vLLM选型与实战
2026/9/18 3:50:02
深入剖析STL六大容器内部实现:内存布局、迭代器失效与容器选型
2026/9/18 3:50:02
Agent-Reach 智能体触达层:消息可靠送达与频控幂等设计
2026/9/18 3:50:02
Agent-Reach协议:CLI插件的安全契约与沙箱运行时规范
2026/9/18 3:50:02
神经网络驱动的声子晶体带隙逆向设计方法
2026/9/18 3:50:02
YOLO实战入门:从环境配置到工业部署的完整链路
2026/9/18 3:45:02
华为eNSP交换机端口配置实战:VLAN、Trunk、链路聚合与排障
2026/9/18 0:04:47
AReaL 调试指南:从 Agent Workflow 验证到分布式训练死锁诊断
2026/9/18 0:04:47
MATLAB实现GPS L1 C/A信号仿真与二维捕获验证
2026/9/18 0:04:47
彻底搞懂ASCII、Unicode与UTF-8:从乱码根源到编码实战
2026/9/16 18:36:59
拯救者Y7000黑屏故障排查与维修实战指南
2026/9/16 7:38:03
AI SDK Harness 依赖更新指南:掌握 harness 包 SDK 依赖的升级、桥接同步与一致性校验
2026/9/17 4:19:54
Refine v5 Ant Design NumberField 组件实战:基于 Intl 的本地化数字格式化