
从主题到成片3 步用 Pixelle-Video 生成 AI 短视频的完整指南【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-VideoPixelle-Video 是一个开源的 AI 全自动短视频引擎你只需输入一个主题它就能自动写文案、生成 AI 配图与视频、合成语音解说、添加背景音乐最终输出可直接发布的成品短视频全程不需要剪辑经验。为什么一个主题就能变成一条完整视频做一条短视频通常要经历写脚本、找配图、录配音、加音乐、剪辑合成五道工序任何一道都能劝退纯新手。Pixelle-Video 把这五道工序合并成了一条流水线文案生成、配图规划、逐帧处理、视频合成每一步背后接的是可替换的 AI 模块所以它既能全自动跑完也允许你在中途插手调整。两条路径把界面跑起来如果你用的是 Windows最省事的方式是下载官方整合包解压后双击start.bat浏览器会自动打开本地界面整个过程不用装 Python、uv 或 ffmpeg。macOS 和 Linux 用户则先装好uv和ffmpeg然后执行下面三条命令git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py启动后浏览器自动打开http://localhost:8501你会看到三栏布局左边输入内容和选音乐中间配置语音与视觉右边生成并预览视频。首次配置给系统接上 AI 大脑第一次使用时展开侧边栏的「⚙️ 系统配置」有三块需要填写LLM 配置从预设下拉框里选通义千问、GPT-4o、DeepSeek 或本地 Ollama选中后 base_url 和模型名会自动填充你只需补 API KeyComfyUI / RunningHub 配置本地有显卡就填 ComfyUI 地址默认http://127.0.0.1:8188并点「测试连接」没有显卡就填 RunningHub 的 API Key 走云端API 媒体模型配置不想走工作流的话也可以直连 DashScope、OpenAI GPT Image、Seedream、Seedance、Kling 等供应商填密钥并可选本地代理填完点「保存配置」系统就进入可用状态。所有工作流定义都放在 workflows/ 目录本地部署selfhost和云端RunningHub两套并存你随时可以切换。文案怎么写交给 AI还是自带稿子视频质量的第一变量是文案Pixelle-Video 在左侧内容输入区提供了三种进入方式覆盖没想法和有稿子两种情况。AI 创作输入主题并指定分镜数选择「 AI 创作」模式后在输入框写一个具体主题比如如何增加被动收入再拖动分镜滑块决定视频长度3 到 30 个分镜默认 5 个分镜越多视频越长。系统会自动为每个分镜创作一段旁白你不需要自己动笔。主题越具体文案越贴合宽泛的主题如成功学产出容易空泛建议落到可执行的知识点上。自行创作三种方式切分现成文案如果稿子已经写好切到「✍️ 自行创作」模式直接粘贴全文然后选择分割方式按段落、按行或按句子切分每切出一段就对应一个分镜。写口播稿的人通常按行排版选按行即可长文按句子切能让节奏更细。标题栏可选填用来覆盖视频标题。批量模式一次排产几十条做系列内容时打开「批量模式」每行写一个主题一次最多 100 个系统会逐个生成独立视频并可用统一的标题前缀和分镜数保证整批风格一致。界面会实时显示识别到的主题数量和预览列表适合先把选题库整理好再集中跑把等待时间压缩到一次开机里。声音与画面决定成片观感的两个旋钮文案确定后剩下两个变量——用什么声音、套什么画面——决定了视频最终的气质。为视频选声音也可以克隆你自己的音色中间栏的 TTS 区域从下拉框选择语音工作流系统会自动扫描 workflows/ 里的 TTS 配置Edge-TTS 稳定清晰、适合大多数解说场景Index-TTS 支持声音克隆上传一段 MP3/WAV/FLAC 参考音频后成片里就是你的声音适合打造有辨识度的账号 IPSpark-TTS 则提供更丰富的情感表达。选好引擎后输入一句测试文本点「预览语音」就能试听确认效果再开始正式生成避免整条视频跑完才发现声音不对。挑模板竖屏、横屏、方形三档尺寸视觉模板用 HTML 定义画面布局全部存放在 templates/ 目录并按尺寸分组命名前缀直接说明素材类型static_*是纯文字静态模板不调用 AI 生图生成最快成本最低image_*用 AI 生成的图片做背景video_*则用 AI 生成的动态视频做背景。尺寸覆盖竖屏 1080x1920抖音、快手、横屏 1920x1080B站、YouTube和方形 1080x1080Instagram、朋友圈三档。选模板前先点「预览模板」看效果例如治愈系内容选 Healing 模板图书解读选 Book 模板用提示词前缀控制配图风格图像生成部分可以切换 ComfyUI 工作流、RunningHub 云端或api/...直连模型需先在系统配置中填好对应供应商密钥默认工作流是 FLUX。图像尺寸默认为 1024x1024 像素可按模型上限调整。真正控制画风的是提示词前缀——一段英文描述会附加到每个分镜的出图请求上比如Minimalist black-and-white matchstick figure style illustration, clean lines能稳定产出火柴人简笔画风。改完前缀先点「预览风格」验证单张效果再投入整条视频能省掉大量返工。三个案例不同输入会产出什么视频抽象的功能不如具体结果下面三个组合都只用标准快速创作流水线差别只在参数。案例一养生科普竖屏视频主题输入每天晨起一杯水的 5 个好处分镜 6 个TTS 选 Edge-TTS模板用养生科普向的竖屏模板提示词前缀设为水墨插画风。产出是一条 60 秒上下的竖屏科普片每个知识点配一幅柔和插画语速平稳适合直接发短视频平台。案例二科技感横屏解说主题大模型如何改变内容创作选横屏 1920x1080 的暗黑科技或电影风模板配图前缀写霓虹科技风英文描述BGM 选内置电子乐并把音量滑到 0.2 左右压在人声之下。成片呈现冷色调、强对比的画面节奏适合 B站或 YouTube 的解说向内容。案例三一句话名言卡片批量生产用批量模式一次贴入 10 条人生感悟类短句固定 3 个分镜套用方形 1080x1080 极简边框模板静态模板不出图所以速度快、成本低。跑完就得到一组版式统一、可直接发朋友圈或 Instagram 的名言卡片标题前缀统一加今日一句形成系列感。常见问题与上手建议生成一条视频要多久产物存在哪时长取决于分镜数、网络和 AI 推理速度5 个分镜的视频通常几分钟内完成右侧栏会实时显示分镜 3/5 - 生成插图这类进度。所有成片自动保存在output/文件夹按时间戳命名Web 界面的「History」页可以回看所有历史项目方便对比参数。运行成本有多高能否免费完全免费方案存在LLM 用本地 Ollama 加本地部署的 ComfyUI整套零花费前提是本地显卡跑得动模型。预算敏感又想要质量的推荐组合是通义千问API 成本极低加本地 ComfyUI完全没有显卡就用 RunningHub 云端出图费用更高但省去了本地环境。效果不满意时按什么顺序调整按性价比排序试四件事先换 LLM 预设改文案风格再改提示词前缀换配图画风然后换 TTS 工作流或上传参考音频最后才动模板和尺寸。每次只改一项才能定位到底是哪个环节不对味。详细配置项说明可查阅 docs/zh/ 目录下的官方使用文档。下一步可以做的四件事装好环境后先用默认参数跑一条 5 分镜的视频熟悉完整流程把一条自己满意的成片参数LLM、TTS、模板、前缀截图存档作为以后复刻的基准用自己的一段音频测试 Index-TTS 声音克隆验证音色效果攒够 10 个同系列选题后开批量模式一次跑完建立内容库【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考