
10分钟做出第一条AI短视频Pixelle-Video 实操上手指南【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video想做短视频卡在剪辑上的人比你想得多写文案要一个下午找素材再要一个打开剪辑软件面对时间线又懵了。Pixelle-Video 是一个 AI 全自动短视频引擎思路很简单——你输入一个主题它自动写解说词、生成 AI 配图、合成语音、加背景音乐最后直接输出成片。读完这篇文章你能在自己的机器上跑起它并产出一条完整的短视频。5分钟跑起 Web 界面Windows 用户最省事到项目 Releases 页面下载官方整合包解压后双击start.bat不用装 Python 和 ffmpeg。macOS / Linux 走源码方式先装好两个依赖macOS 执行brew install ffmpegUbuntu 执行sudo apt install ffmpeg再安装包管理器 uv按其官方文档一行命令即可。然后克隆并启动git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py浏览器会自动打开http://localhost:8501看到三栏界面就算部署成功。首次配置只填两处展开右上角的「⚙️ 系统配置」必须完成两项LLM 配置下拉选一个预置模型通义千问、GPT-4o、DeepSeek、Ollama 本地模型等填入API Key。它负责写文案。图像生成服务本地有显卡就填 ComfyUI 地址默认http://127.0.0.1:8188没有就填 RunningHub 的 API Key 走云端生成。点「保存配置」。更细的配置项可以对照 配置说明 逐项看。四项核心能力拆解从主题到脚本解决不会写文案左侧「内容输入」有两种模式。AI 生成输入主题如如何养成阅读习惯AI 自动写出完整解说词适合没灵感时快速起步。固定文案直接粘贴现成脚本支持按段落、行或句子分割成镜头适合产品信息、引用这类必须一字不差的场景。想连续做系列视频时在文本框里每行写一个主题系统会为每个主题各生成一条视频。画面与模板解决画面从哪来模板决定画面布局分三类static_*纯文字排版、image_*用 AI 图片做背景、video_*用 AI 动态视频做背景尺寸覆盖竖屏 1080x1920、横屏 1920x1080、方形 1080x1080选择时可看预览图。选图片/视频模板时需要再选一个图像生成工作流默认runninghub/image_flux.json并可设置提示词前缀英文统一所有配图的风格。所有模板收录在 templates 目录效果总览见 模板文档。什么时候用手上没有 ComfyUI就先用静态模板零配置、出片最快先把流程走通。解说与音色解决谁在说话中间栏选一个 TTS 工作流即可Edge-TTS 免费、开箱即用Index-TTS 支持声音克隆——上传一段参考音频合成语音会模仿这个人的声线。正式生成前输入测试文本点「预览语音」先试听不满意就换音色或调语速别等到成片才发现不对。背景音乐解决干声没氛围BGM 可选「无 / 内置音乐 / 自定义」把自己的 MP3、WAV 文件放进bgm/文件夹会自动出现在选择列表里还能点击「试听 BGM」预览。三个高频场景的照抄配方配置项知识科普产品/科技推广情感治愈画幅竖屏 1080x1920横屏 1920x1080竖屏 1080x1920模板1080x1920/static_default.html1920x1080/image_wide_darktech.html1080x1920/image_healing.html提示词前缀Minimalist design, clean lines, educational styleModern technology, futuristic, product showcaseEmotional, warm, cinematic, soft light音色清晰、语速适中有活力、有感染力温和语速放慢BGM轻柔纯音乐节奏感强的电子乐钢琴轻音乐脚本模式AI 生成固定文案AI 生成或自写避坑与提速4个高频问题现象出片很慢。原因每个分镜要依次生成图片/视频云端服务还有排队。解决减少分镜数量有本地显卡优先走本地 ComfyUI只想看效果就先跑静态模板速度最快。现象AI 配图风格不统一或质量差。原因提示词前缀太简单或用了中文描述。解决前缀写英文并加细节例如Chinese ink painting style, elegant, minimalistic确认图像尺寸与模板匹配点「预览风格」先测一张。现象解说声音生硬、和主题不搭。原因默认 TTS 音色和内容调性不一致。解决换 TTS 工作流或上传参考音频做声音克隆调整语速务必用「预览语音」先试听再整片生成。现象ComfyUI 或 LLM 调用失败。原因服务没启动、地址填错或 API Key 无效。解决在配置面板点「测试连接」确认 ComfyUI 在线核对 Key 与网络。想零花费可走 Ollama 本地模型 本地 ComfyUI 的组合。收尾带走这几句启动只需要两样一个 LLM API Key 和一个图像生成服务其余都有默认值。静态模板是零配置、零成本的体验路径建议第一条视频用它跑通全流程。做系列内容批量模式 固定提示词前缀视觉风格就能保持一致。品牌或人设内容值得上一版声音克隆音色统一后辨识度明显提升。进阶方向两个把 ComfyUI 里调好的工作流导出 JSON 放进 workflows/ 目录就能在界面里直接选用另外 Web 端还提供数字人口播、图生视频、动作迁移等扩展流水线接口细节见 API 文档。想翻源码的话看这三处就够视频合成核心pixelle_video/services/video.py配置入口config.example.yaml复制为config.yaml使用模板文件templates/挑一个你关心的主题现在跑一遍几分钟后去output/目录看你的第一条成片。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考