Pixelle-Video 快速上手:五分钟从零生成你的第一条 AI 全自动短视频

发布时间:2026/9/10 19:13:42
Pixelle-Video 快速上手:五分钟从零生成你的第一条 AI 全自动短视频 Pixelle-Video 快速上手五分钟从零生成你的第一条 AI 全自动短视频【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video本指南是 Pixelle-VideoAI 全自动短视频引擎的官方快速入门教程面向已完成安装与配置的用户只需输入一个主题系统便会自动完成文案撰写、配图/视频生成、语音合成与视频合成。读完本文你将掌握 Web 界面的启动方式、系统配置检查方法以及输入主题 → 生成视频 → 预览导出的完整实操流程最快可在几分钟内产出第一条成片。启动 Web 界面Pixelle-Video 的所有创作能力都集中在 Streamlit Web 界面中启动方式取决于你的安装渠道。Windows 一键整合包用户无需安装 Python、uv 或 ffmpeg解压后直接双击start.bat即可启动浏览器会自动打开http://localhost:8501。整合包已内置全部依赖首次使用只需配置 API 密钥。从源码安装的用户在项目根目录执行uv 会自动安装依赖并运行uv run streamlit run web/app.py启动后浏览器会自动打开http://localhost:8501。入口文件 web/app.py 使用 Streamlit 的st.navigation定义了首页pages/1__Home.py与历史记录页pages/2__History.py两个页面其中首页为默认页。认识三栏布局首页 web/pages/1__Home.py 通过st.columns([1, 1, 1])渲染出经典三栏创作界面实现见 web/pipelines/standard.py栏位内容对应组件左侧栏内容输入主题/文案、BGM、版本信息web/components/content_input.py中间栏语音设置TTS、视频模板、图像/视频生成工作流web/components/style_config.py右侧栏生成按钮、实时进度、视频预览与下载web/components/output_preview.pyStep 1检查系统配置首次使用必须展开「⚙️ System Configuration」面板完成配置。根据 web/components/settings.py 的源码该面板采用未配置时自动展开、已配置后折叠的逻辑expandednot config_manager.validate()包含三大部分LLM 配置生成文案的大脑LLM 负责为你的主题创作视频解说词。支持两种方式快速预设选择从下拉菜单选择预设模型系统会自动填充base_url与model。内置预设定义在 pixelle_video/llm_presets.py均兼容 OpenAI SDK 协议预设base_url默认 model备注Qwenhttps://dashscope.aliyuncs.com/compatible-mode/v1qwen-max性价比高推荐OpenAIhttps://api.openai.com/v1gpt-4o—Claudehttps://api.anthropic.com/v1/claude-sonnet-4-5—DeepSeekhttps://api.deepseek.comdeepseek-chat—Ollamahttp://localhost:11434/v1llama3.2本地运行完全免费默认 API Key 填ollamaSDK 要求但被忽略Moonshothttps://api.moonshot.cn/v1moonshot-v1-8k—手动配置选择「Custom」后手动填写API Key、Base URL与Model三个必填项。配置面板还提供了「 加载模型列表」与「 测试连接」按钮分别调用 pixelle_video/utils/llm_util.py 中的fetch_available_models与test_llm_connection验证服务可用性。图像/视频生成配置配图与视频片段的生产线两种部署方式二选一本地部署ComfyUI填写本地 ComfyUI 服务地址默认http://127.0.0.1:8188可附带 ComfyUI API Key点击「测试连接」会请求/system_stats端点验证连通性。云端部署RunningHub填写 RunningHub API Key 即可无需本地 GPU。可选高级项并发限制1–10默认 1与实例类型24GB / 48GB 显存48GB 用于大型视频生成。API 媒体模型配置可选当选用api/...直连模型工作流时需在此配置对应供应商的密钥支持OpenAI / GPT ImageGPT 图像生成模型Base URL 默认https://api.openai.com/v1DashScope / Wan / HappyHorse通义万象图像、视频生成Base URL 默认https://dashscope.aliyuncs.com/api/v1Volcengine ARK / Seedream / Seedance字节 Seedream 图像与 Seedance 视频生成Base URL 默认https://ark.cn-beijing.volces.com/api/v3Kling AI / 可灵可灵视频生成Base URL 默认https://api-beijing.klingai.com需 Access Key 与 Secret Key。每个供应商可单独开启本地代理如http://127.0.0.1:9090勾选「打印模型请求参数」可在终端输出发送给模型的 prompt、模型名与输入文件路径便于调试。若只使用 ComfyUI 或 RunningHub可跳过 API 媒体模型配置选择api/...工作流时则必须填写对应供应商密钥。填写完毕后点击「保存配置」config_manager.save()会将配置持久化到项目根目录的config.yaml参考模板见 config.example.yaml。未配置完成时右侧栏会提示 System not configured 并阻止生成。Step 2输入创作主题在左侧栏「 Content Input」区域选择**「AI Generate Content」**模式在文本框输入一个主题例如Why develop a reading habit可选调整分镜数量即场景数滑块范围为 3–30默认 5 帧见 web/components/content_input.py 中st.slider(min_value3, max_value30, value5)。常用主题示例Why develop a reading habitHow to improve work efficiencyThe importance of healthy eatingThe meaning of travel两种生成模式除 AI 生成外还可以选择**「Fixed Content」固定文案模式**直接粘贴完整解说词跳过 AI 创作环节适合已有现成文案、希望精确控制内容的场景。固定模式下还支持选择脚本切分方式段落 / 行 / 句子决定文案如何被拆分为分镜。背景音乐BGM左侧栏可配置背景音乐无 BGM纯人声解说、内置音乐预置音频如default.mp3或自定义音乐将 MP3/WAV/FLAC 等文件放入bgm/文件夹后自动出现在下拉列表中可点击「试听 BGM」预览音量滑块范围为 0–0.5、默认 0.2。Step 3配置语音与视觉在中间栏完成以下两类设置。语音设置Voice Settings根据 web/components/style_config.py 的源码TTS 支持两种推理模式本地模式local默认直接调用 Edge-TTS可选择音色默认zh-CN-YunjianNeural完整音色表见 pixelle_video/tts_voices.py与语速0.5x–2.0x默认 1.2xComfyUI 模式comfyui从下拉菜单选择 TTS 工作流系统会自动扫描 workflows/ 文件夹中的 TTS 工作流如tts_edge.json、tts_index2.json。声音克隆上传参考音频支持 MP3/WAV/FLAC/M4A/AAC/OGG适用于支持克隆的工作流如 Index-TTS上传后可直接试听。两种模式均提供「预览语音」功能输入测试文本即可试听合成效果支持携带参考音频预览。视觉设置Visual Settings图像生成工作流从下拉菜单选择配图工作流来源包括RunningHub云端/ Selfhost本地/ API直连模型三种默认使用image_flux.json。选择api/...工作流时需先在上一步的 API 媒体模型配置中填写供应商密钥。选择模板后媒体尺寸会由模板自动解析parse_template_size/get_media_size无需手动指定宽高提示词前缀Prompt Prefix控制图像整体风格需使用英文例如Minimalist black-and-white matchstick figure style illustration, clean lines, simple sketch style可点击「预览风格」实时测试内部通过build_image_prompt拼接最终 prompt视频模板决定画面的布局与设计按尺寸分组展示竖屏/横屏/方形默认推荐竖屏1080x1920。模板命名规范static_*.html为纯文字静态模板、image_*.html为 AI 配图背景模板、video_*.html为 AI 视频背景模板。界面支持直接预览模板效果、自定义模板参数也可在 templates/ 下自行编写模板。Step 4生成视频所有参数确认后点击右侧栏的「 Generate Video」按钮。系统会通过pixelle_video.generate_video()进入全自动流水线右侧栏实时展示进度对应 web/components/output_preview.py 中的ProgressEvent回调Generate script— LLM 根据主题创作解说词并规划分镜Generate images— 为每个分镜生成配图或视频片段Synthesize voice— 合成语音解说并混入 BGMCompose video— 套用模板逐帧渲染并合成最终视频。进度条会细化到分镜级别例如「分镜 3/5 - 生成插图」。若选择了video_*.html动态视频模板系统会要求先选择视频生成工作流或 API 视频模型否则会阻止生成并给出提示。生成耗时参考生成一段 5 分镜视频约需2–5 分钟主要取决于LLM API 响应速度、图像生成速度、TTS 工作流类型与网络状况。批量模式下系统按每视频约 3 分钟估算总耗时。Step 5预览与导出视频生成完成后右侧栏会自动播放视频预览并展示 视频预览播放器⏱️ 视频时长 / 生成耗时 文件大小MB 分镜数量 视频分辨率由所选模板决定视频文件默认保存在项目根目录的output/文件夹中界面同时提供「⬇️ Download Video」按钮可直接将成片下载到本地。下一步学习路径恭喜你已经成功生成了第一条 AI 全自动短视频 接下来可以继续深入自定义视觉风格— 参见 Custom Visual Style 教程参考音频声音克隆— 参见 Voice Cloning with Reference Audio 教程调用 API 生成视频— 参见 API 使用指南开发自己的模板— 参见 模板开发指南更完整的配置说明— 参见 Configuration Guide若在配置或生成过程中遇到问题可先阅读 FAQ 与 Troubleshooting或在 Web 界面侧边栏内置的 FAQ 中查找答案。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考