输入一个主题就能出片:Pixelle-Video AI短视频生成工具完整上手指南
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
周五下午五点,运营在群里丢来一句"明天要一条科普短视频",而你既没写过脚本,也没剪过片。把主题丢给 Pixelle-Video——一个输入主题就能自动产出文案、配图、配音和成片的全自动 AI 短视频生成工具,几分钟后你就拿到了可直接发布的成品。这篇文章带你从零跑通它,再讲清楚模板定制、模型成本方案和三类高频坑。
一分钟认识 Pixelle-Video:它替你干了哪些活
传统短视频要经历写文案、找素材、剪辑、配音、配乐五个环节。Pixelle-Video 把这五个环节收进一条流水线:文案生成 → 配图规划 → 逐帧处理 → 视频合成,你只负责给主题和挑风格。
| 能力 | 说明 | 对你的价值 |
|---|---|---|
| 全自动成片 | 输入主题即生成文案、AI 配图、语音解说并合成视频 | 不写脚本、不剪辑也能出片 |
| 多模板风格 | 内置竖屏 1080x1920、横屏 1920x1080、方形 1080x1080 的 HTML 模板 | 抖音、B站、小红书一套内容多端适配 |
| 多模型接入 | 文案支持通义千问、GPT、DeepSeek、Ollama 等 | 本地免费或云端按需切换 |
| 工作流可替换 | 基于 ComfyUI 架构,图像、视频、TTS 能力均可换 | 有显卡可本地跑,没显卡走云端 |
| 声音克隆 | 上传 10–30 秒参考音频,用 Index-TTS 克隆音色 | 固定人设口播,风格统一 |
从获取到出片:完整上手链路
获取
git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-VideoWindows 用户也可以直接下载官方整合包,免装 Python 和 ffmpeg,解压后双击start.bat即可。
配置
首次打开界面后展开左侧「⚙️ 系统配置」面板,需要填两块:
- LLM 配置:从预设里选模型(通义千问、GPT-4o、DeepSeek、Ollama),系统会自动填好
base_url和model,你再补上 API Key - 图像/视频生成:有本地显卡填 ComfyUI 地址(默认
http://127.0.0.1:8188)并点「测试连接」;没有显卡就填 RunningHub 的 API Key 走云端
填完点「保存配置」,配置会写入config.yaml。
运行
uv run streamlit run web/app.py浏览器会自动打开http://localhost:8501。左侧「📝 内容输入」选「AI 生成内容」,输入主题(如"如何提高工作效率"),中间栏保持默认的 Edge-TTS 和image_flux工作流,选一个竖屏模板,然后点右侧「🎬 生成视频」。
验证结果
判断是否跑通,看三点:右侧出现自动播放的视频预览;进度条走完「生成文案 → 生成配图 → 合成语音 → 合成视频」四步;output/文件夹里多出一个 mp4 文件,且时长、分镜数、尺寸与你的设置一致。5 个分镜的视频通常 2–5 分钟完成。
三个典型场景:输入与产出对照
场景一:科普思辨视频。输入"为什么我们还没有找到外星文明",选横屏电影风模板,AI 会生成带悬念感的分镜文案并配电影感画面,适合投 B站、YouTube。
场景二:书单号。用「固定文案内容」模式,把现成书单文案粘进去,选「按段落分割」,每段自动成为一个分镜,配image_book模板,省去 AI 写稿环节,风格更可控。
场景三:科技产品测评。输入"某款笔记本的选购指南",配暗黑科技模板,画面调性和内容气质一致,比通用模板更贴内容。
进阶玩法:模板定制与模型成本
按分辨率挑模板、改模板
模板全部放在 templates/ 目录,按尺寸分组,命名前缀决定类型:static_*纯文字不出图、最省成本;image_*用 AI 图做背景;video_*用 AI 视频做背景。想改风格就复制一个现有模板,改 HTML/CSS 里的字体、颜色、布局,模板内可用{{ title }}、{{ text }}、{{ image }}三个变量。改完在界面里点「预览模板」即可验证,不必重新生成整条视频。
模型怎么搭配最省钱
| 方案 | 搭配 | 成本 |
|---|---|---|
| 完全免费 | Ollama(本地 LLM)+ 本地 ComfyUI + Edge-TTS | 0 元,需显卡 |
| 性价比 | 通义千问 + 本地 ComfyUI | 一条 3 分镜视频约 0.01–0.05 元 |
| 免本地环境 | OpenAI/通义千问 + RunningHub 云端 | 按量付费,无需维护硬件 |
排障避坑:三类高频问题
- ComfyUI 连接失败→ 原因多为服务没启动或地址填错。先确认 ComfyUI 在运行,核对 URL 是否为默认的
http://127.0.0.1:8188,再点「测试连接」。 - LLM 文案生成报错→ 通常是 API Key 填错、账户余额不足或网络不通。对照错误提示里的具体原因逐项排查,别盲目重试。
- 依赖安装失败、启动报错→ 先执行
uv cache clean清理缓存再uv sync;仍失败检查 Python 版本和 ffmpeg 是否可用(ffmpeg -version验证)。
更细的分类参考 docs/zh/troubleshooting.md,接口能力可看 docs/zh/user-guide/api.md。
延伸学习与行动清单
官方文档在 docs/,工作流 JSON 示例在 workflows/,可对照着扩展自己的图像、TTS、视频工作流。三条建议:先跑通一条 3 分镜的竖屏视频再谈批量;同一主题换 2–3 个模板对比出片率,沉淀出你自己的一套模板库;跑通后把 LLM、模板、TTS 的组合记下来,下次直接复用。
打开终端,克隆仓库,输入你第一个想拍的主题——成片的距离比你想象的近。
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考