Pixelle-Video 快速指南:3 分钟从一个主题到一条 AI 短视频成片

发布时间:2026/9/5 17:50:11
Pixelle-Video 快速指南:3 分钟从一个主题到一条 AI 短视频成片 Pixelle-Video 快速指南3 分钟从一个主题到一条 AI 短视频成片【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video假设你手头有一段文案想把它变成带配音、带画面的成片。Pixelle-Video 做的就是这种 AI 短视频生成的完整闭环输入一个主题或一段文字它自动完成写文案、AI 配图、语音解说、背景音乐和合成最后给你一条能直接发布的短视频。不需要你会剪辑也不需要你自己部署模型。 三分钟跑起来安装与启动步骤Windows 用户只要两步Mac/Linux 用户四条命令就够了前置环境只需要 Python 3.10 和 uv 包管理器。git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv sync uv run streamlit run web/app.pyWindows 用户跳过这四行从项目 releases 页下载整合包解压后双击 start.bat浏览器会自动打开 http://localhost:8501 。打开界面后在「系统配置」里填好 LLM 的 API Key 和图像生成服务任何 OpenAI 兼容接口的模型都行再输入主题点「生成视频」等 2-5 分钟就拿到第一条成片。 一条从文字到成片的流水线四步是怎么跑的点下「生成」之后后台跑的是「文案 → 画面 → 配音 → 合成」这四步。先由 LLM 根据主题写出解说文案拆成若干分镜默认 5 个接着每个分镜生成一张图或一段视频用纯文字模板则跳过这步然后 TTS 把文案读成语音最后画面、配音、BGM 拼成成片在 Web 界面自动播放文件存在 output/ 目录里。每一步用的模型都能单独换整个过程有实时进度你能看到当前卡在哪一步。 功能速览尺寸、模板、模型一张表看清下面这张表把支持的尺寸、模板类型、模型和部署方式逐项列出来了。能力支持内容视频尺寸1080x1920 竖屏、1920x1080 横屏、1080x1080 方形三种规格模板类型static_* 纯文字、image_* AI 配图、video_* AI 视频背景预置 20 余种TTS 方案Edge-TTS、Index-TTS、Spark-TTS支持上传参考音频做声音克隆图像模型FLUX、SDXL、Qwen、Z-Image、SD 3.5、Nano Banana 等视频模型WAN 2.1/2.2、FusionX、Qwen-WAN、Seedance、Kling 等LLM任何 OpenAI 兼容接口通义千问、GPT、DeepSeek、本地 Ollama部署方式Windows 整合包、源码安装uv 或 pip、Docker 三个真实用例科普、产品宣传、社媒日更能直接落地吗这三个用例你现在就能照着做。我想做一条科普短视频。输入「为什么植物需要光合作用」这类主题AI 自动写解说词并拆成 5 个分镜得到的是一条带配音、每个分镜配插图的竖屏科普视频。画面风格不满意换一个模板重跑就行。我想做一条产品宣传。把产品卖点文案贴进固定脚本模式选 1920x1080 横屏模板得到的是一条可以直接放电商详情页或 YouTube 的宣传视频。想统一品牌色通过 template_params 参数调主题色即可。我想做社媒日更。输入当天选题把 n_scenes 设成 3 让成片更短选 1080x1080 方形模板适配信息流。历史页面支持批量创建任务一天几更可以一次排完。 进阶定制模板、音色、工作流想深入定制吗只需要动三个地方的文件不用啃源码。自定义模板在哪里改把新的 HTML 文件放进 templates/ 目录按尺寸1080x1920 等分文件夹存放Web 界面就能直接选。命名约定是 static_* / image_* / video_*static 开头意味着不需要 AI 生图。换 TTS 音色在哪里改Edge-TTS 的音色列表预置在 pixelle_video/tts_voices.py在 Web 界面选 TTS 工作流时切换即可。想用自己的声音上传一段参考音频走声音克隆不用额外部署。怎么挂 ComfyUI 工作流在 ComfyUI 里把工作流导出为 JSON放进 workflows/ 目录再在配置里填 comfyui_url 和默认工作流路径。不想本地部署的话填一个 RunningHub API Key 就能用云端 ComfyUI。不想开 Web 界面也可以用 Python API 直接调本质就是一次 AI 文字转视频import asyncio from pixelle_video.service import PixelleVideoCore async def main(): p PixelleVideoCore() await p.initialize() r await p.generate_video(text为什么要养成阅读习惯, modegenerate, n_scenes5) print(r.video_path) asyncio.run(main())常见问题生成慢怎么调、平台尺寸、换模型生成太慢怎么调5 个分镜的成片通常需要 2-5 分钟耗时主要在 LLM 和图像生成上。减少分镜数、换纯文字静态模板不跑生图、或选更快的图像工作流都能明显提速。支持哪些平台尺寸1080x1920 对应抖音、快手竖屏1920x1080 对应 YouTube、B 站横屏1080x1080 对应信息流方形三种规格都有现成模板。能换自己的模型吗LLM 支持任何 OpenAI 兼容接口包括本地 Ollama图像和视频可以走自部署 ComfyUI、RunningHub 云端或直连 DashScope、OpenAI、Kling 等 API。必须部署 ComfyUI 吗不一定。纯文字静态模板完全不需要生图想要 AI 配图也可以选 RunningHub 云端或直连 API 方案本地零部署。如果你不想碰剪辑、只希望从主题和文案批量出成片Pixelle-Video 是目前短视频自动化里上手成本很低的工具但如果你要复杂转场、角色动画或逐帧精修它替代不了正经的剪辑流程。具体功能差异和参数细节以仓库最新文档为准。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考