恒美微站
首页
关于我们
建站服务
主题模板
案例展示
资讯中心
联系我们
输入一个主题就能出片:Pixelle-Video 全自动短视频引擎上手指南
首页
资讯中心
/
输入一个主题就能出片:Pixelle-Video 全自动短视频引擎上手指南
输入一个主题就能出片:Pixelle-Video 全自动短视频引擎上手指南
发布时间:2026/9/8 21:07:43
输入一个主题就能出片Pixelle-Video 全自动短视频引擎上手指南【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video你写完一串知识笔记想剪成短视频发出去却连剪辑软件都没打开过文案不会写、配图不知道去哪找、配音不会录、字幕对不上口型。你看到AI 全自动做视频的说法又不知道具体从哪入手、会不会卡在环境配置上。Pixelle-Video 是一个开源的 AI 全自动短视频引擎你输入一个主题它自动生成解说文案、AI 配图和语音解说再配上背景音乐合成完整视频。它替你省掉写稿→找图→录配音→剪辑整条流水线没剪辑经验也能在几分钟内做出第一条能直接发的短视频。书籍风格模板示例AI 配图 自动排版文字 语音解说最终合成的就是这样一个完整视频它怎么工作从主题到成片只分 4 步整个流程可以压成一行主题输入 → 文案生成 → 配图与配音 → 视频合成。第一步大语言模型LLM根据你的主题写出完整解说词并切成若干分镜默认 5 个。第二步每个分镜的文案会各生成一张 AI 配图同时由 TTS 引擎读成语音。第三步叠加背景音乐用 FFmpeg 把图、音频、字幕合成视频文件落在output/目录。每一步你都可以在 Web 界面上看到实时进度比如分镜 3/5 - 生成插图。文案、配图、语音、模板都是可替换的组件——换个模型、换个模板结果就不同但你不需要了解底层实现全程在下拉菜单里选。3 步跑起来5 分钟拿到第一条视频最小环境要求Python 3.11 和包管理器uvWindows 用户可以直接下官方一键整合包不用装任何环境双击start.bat即可。第 1 步克隆并启动浏览器会自动打开http://localhost:8501git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py # uv 会自动装好全部依赖第 2 步配置 AI 服务一次性。展开「⚙️ 系统配置」LLM 下拉选通义千问粘贴你的 API Key图像生成选 RunningHub 并填 Key或填本地 ComfyUI 地址点「保存配置」。第 3 步生成。左侧「内容输入」选 AI 生成内容输入主题比如为什么要养成阅读习惯TTS 保持默认 Edge-TTS模板保持默认竖屏点「 生成视频」。你会看到什么进度条依次走过文案、配图、语音、合成四步5 个分镜大约 2-5 分钟。完成后右侧自动播放成片并显示时长、文件大小和分镜数——这是一条带配音、带配图、可直接上传抖音或 B 站的竖屏短视频而不是几张散图。值得知道的 4 个能力固定脚本模式不想让 AI 写稿直接粘贴你的现成文案选段落、行或句子三种分割方式跳过文案生成直接出片。适合已有成熟稿子、只缺画面和配音的人。自定义素材上传自己的照片或视频系统会先分析素材内容再生成匹配的脚本。适合手里有实拍素材、想素材说话而不想纯靠 AI 配图的人。声音克隆给支持克隆的工作流如 Index-TTS传一段参考音频成片就用这个音色朗读。适合做个人 IP、想保持账号声音统一的创作者。模板库竖屏 1080x1920 有 20 多个模板横屏 1920x1080 也有 5 个命名即用途——static_*纯文字、image_*用 AI 配图、video_*用 AI 视频做动态背景。模板源码在 templates/会 HTML 就能加自己的。电影风格横屏模板黑底居中画面 标题排版适合影视解说、B 站横屏内容LLM 和图像生成怎么选一张表给新手你的情况LLM 选图像/视频选说明有 NVIDIA 显卡约 6GB 显存Ollama 本地本地 ComfyUI全链路 0 API 费用无显卡、想低成本新手默认推荐通义千问RunningHub 云端千问按量计费很低RunningHub 无需本地部署完全不想碰 ComfyUI任意云端 LLM直连 API 模型DashScope、Seedream、Seedance、Kling 等在系统配置里填 Key 即可三个默认值记住就行LLM 用通义千问、TTS 用 Edge-TTS、模板用默认竖屏。详细的预设模型列表见 pixelle_video/llm_presets.py工作流 JSON 在 workflows/。适合谁不适合谁适合要批量产竖屏口播类内容知识科普、影视解说、产品介绍的人有现成文案、只缺配图和配音的人想零剪辑经验起步、用 AI 模型成本换人工时间的账号主。不适合要求完全离线且机器没显卡的人——本地 ComfyUI 路线需要一块 NVIDIA 显卡纯云端路线则有 API 费用也不适合需要逐帧精剪、加复杂转场特效的场景它是生成不是剪辑不满意的手段是换参数重新生成。项目边界和使用细节可看 官方 FAQ。常见问题一个视频要生成多久5 个分镜约 2-5 分钟取决于 LLM 和图像 API 的响应速度进度条会实时显示当前卡在哪一步。必须花钱吗软件本身开源免费Apache 2.0。Ollama 本地 ComfyUI 可以零 API 费用跑通全流程但需要显卡走云端服务则按各家的量计费。不装 ComfyUI 能出片吗能。可以直连 DashScope、OpenAI、Kling 等 API 模型也可以选static_*纯文字模板完全不生成媒体。背景用自己的音乐行吗行把 MP3/WAV 放进bgm/文件夹就能选界面上还有内置曲库可以试听。输出尺寸有哪些竖屏 1080x1920、横屏 1920x1080另有 1080x1080 方形模板对应抖音、B 站、小红书等平台。下一步动作克隆仓库后按上面的 3 步启动LLM 选通义千问输入为什么要养成阅读习惯5 分钟后你会在output/里看到自己的第一条视频。安装和配置细节参考安装说明与快速上手。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考