Pixelle-Video:输入一个主题,一键自动生成 AI 短视频
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
想做抖音号,却卡在"不会剪辑、不会找图、不会配音"上?Pixelle-Video 是一个 AI 全自动短视频引擎:输入一个主题,它自动写文案、生成 AI 配图、合成语音解说、叠加背景音乐,最后拼成一条可直接发布的短视频。你不用打开任何剪辑软件,整个流程在浏览器里完成。
它能帮你解决什么
场景一:知识类账号的日常更新。你有一个想讲的主题,比如"一本书的核心观点",但写脚本要一小时、找配图要半小时。Pixelle-Video 把这一步压缩成:主题填进输入框,等待 2-5 分钟,得到一条带解说、带配图、带 BGM 的成片。
场景二:治愈、情感类内容的批量产出。这类账号的内容结构高度相似——换主题即可。用它的批量模式,每行填一个主题,系列视频依次生成,模板和声音保持一致,适合养号期快速积累素材。
场景三:不想折腾本地环境的新手。项目支持"零本地依赖"路线:图像走 RunningHub 云端工作流、语音走 Edge-TTS,你只需配置好 API Key 就能出片;有本地显卡的用户则可以接 ComfyUI,实现完全免费的生成方案(LLM 用 Ollama + 本地 ComfyUI)。
极简启动:两条最短路径
路径一:Windows 一键整合包。从项目 Release 页下载整合包并解压,双击start.bat,浏览器会自动打开http://localhost:8501。包内已带 Python 和 FFmpeg,不需要装任何环境。
路径二:从源码启动(macOS / Linux)。前提是已安装uv和ffmpeg,然后执行:
git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.pyuv run会自动装好依赖并启动 Web 界面。启动后是标准的三栏布局:左侧内容输入,中间语音与视觉设置,右侧生成与预览。
首次使用要展开「⚙️ 系统配置」面板,填两处关键项:
- LLM 配置:下拉选择通义千问、GPT-4o、DeepSeek 或本地 Ollama,填入 API Key。
- 图像配置:有本地 ComfyUI 就填地址(默认
http://127.0.0.1:8188)并点「测试连接」;没有就填 RunningHub API Key 走云端。
点「保存配置」,工具就可用了。更详细的字段说明在 docs/zh/getting-started/quick-start.md。
一条主线走到底:生成"为什么要养成阅读习惯"
输入。在左侧「📝 内容输入」区选择"AI 生成内容",主题填"为什么要养成阅读习惯",分镜数量保持默认 5 个。如果已经有写好的稿子,可以改用"固定文案内容"模式,直接粘贴全文,再选按段落、按行或按句子分割。
配置。中间栏保持默认即可跑通:TTS 工作流选 Edge-TTS(免费、清晰),点「预览语音」先听一句效果;图像工作流默认image_flux.json,尺寸默认 1024x1024;视频模板从下拉框选竖屏1080x1920/image_default.html。
生成。点右侧「🎬 生成视频」。进度条会按"生成文案 → 生成配图 → 合成语音 → 合成视频"推进,显示到具体分镜,例如"分镜 3/5 - 生成插图"。5 分镜的视频一般 2-5 分钟完成。
导出。完成后右侧自动播放成片,显示时长、大小和分镜数。视频文件落在项目根目录的output/文件夹,按时间戳命名;历史项目可以在 Web 界面的 History 页面回看和二次编辑。
不同需求怎么调(对号入座)
按发布平台选尺寸。模板按画幅分三组,位于 templates/ 目录:竖屏1080x1920/(抖音、快手、小红书)、横屏1920x1080/(B站、YouTube)、方形1080x1080/(Instagram 等)。同一主题换一组模板重新生成即可。
按内容类型选模板前缀。模板文件名有固定规律,先认这个规律就不用逐个试:
static_*.html:纯文字静态样式,不调用 AI 生图,速度最快、成本最低,适合金句卡片类内容。image_*.html:用 AI 生成的图片做背景,覆盖大多数图文解说场景,如图书解读(image_book)、心理科普(image_psychology_card)、治愈风(image_healing)。video_*.html:用 AI 生成动态视频做背景(如 WAN 2.1),效果最丰富,耗时和费用也最高。
全部模板的预览图在 docs/zh/user-guide/templates.md,选模板前可以先看效果图。
按使用目标换能力模块。想要自己的声音?把 TTS 工作流换成 Index-TTS,上传一段参考音频即可做声音克隆。想要固定配乐?把 MP3 放进bgm/文件夹,左侧「试听 BGM」预览后选用。想批量出片?在内容输入区切到批量模式,每行一个主题,配统一的标题前缀。图像、视频、TTS 三类工作流都放在 workflows/ 目录,懂 ComfyUI 的用户可以往里加自己的工作流。
新手最容易踩的坑
现象:配图环节卡住或报"连接失败"。原因:选了本地 ComfyUI 工作流,但 ComfyUI 没启动、地址写错,或模型没下载。解法:在「系统配置」里点「测试连接」确认服务可用;没有本地显卡的用户直接换用runninghub/开头的云端工作流,绕开本地部署。
现象:点生成后提示 LLM 调用失败。原因:API Key 填错、账户余额不足,或 base_url 与模型不匹配。解法:用配置面板里的预设下拉项自动填充 base_url 和 model,比手填少错;再检查余额和错误提示里的具体信息。
现象:生成的配图风格完全不对味。原因:整体画风由图像设置里的"提示词前缀"(Prompt Prefix)控制,它必须是英文描述。解法:把前缀改成你想要的风格词,例如Minimalist black-and-white matchstick figure style illustration, clean lines, simple sketch style,点「预览风格」单张测试,满意后再跑全片。
现象:一条视频要等很久。原因:分镜数多、云端工作流排队、LLM 响应慢。解法:先把分镜数从 8 降到 5 试跑;图像改用本地 ComfyUI 通常比云端快;本地依赖装不上时按uv cache clean后uv sync重试。更多排查步骤见 docs/zh/troubleshooting.md。
你的第一步
选一个你最熟悉的主题,其余全部用默认值:Edge-TTS +image_flux.json+ 竖屏image_default.html+ 5 个分镜,点「🎬 生成视频」。第一次成片不用追求好看,目标是把"输入到出片"这条链路完整跑一遍。跑通之后,再按前面的"对号入座"一节逐项调整模板、声音和 BGM,逐步把它变成你账号的固定生产线。如果后续想通过 API 而不是 Web 界面调用,可以看 docs/zh/user-guide/api.md。
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考