| 1 | <h1 align="center">🎬 Pixelle-Video —— AI 全自动短视频引擎</h1> |
| 2 | |
| 3 | <p align="center"><a href="README_EN.md">English</a> | <b>中文</b></p> |
| 4 | |
| 5 | <p align="center"> |
| 6 | <a href="https://www.bilibili.com/video/BV1WzyGBnEVp/?vd_source=e7e7d4ca8db9a18c80f17a24a6582fca" target="_blank"><img src="https://img.shields.io/badge/🎥 视频教程-EA4C89" alt="视频教程"></a> |
| 7 | <a href="https://github.com/AIDC-AI/Pixelle-Video/releases" target="_blank"><img src="https://img.shields.io/badge/📦 Windows包-50C878" alt="Windows整合包"></a> |
| 8 | <a href="https://aidc-ai.github.io/Pixelle-Video/zh" target="_blank"><img src="https://img.shields.io/badge/📘 使用文档-4A90E2" alt="使用文档"></a> |
| 9 | <a href="https://github.com/AIDC-AI/Pixelle-Video/stargazers"><img src="https://img.shields.io/github/stars/AIDC-AI/Pixelle-Video.svg" alt="Stargazers"></a> |
| 10 | <a href="https://github.com/AIDC-AI/Pixelle-Video/issues"><img src="https://img.shields.io/github/issues/AIDC-AI/Pixelle-Video.svg" alt="Issues"></a> |
| 11 | <a href="https://github.com/AIDC-AI/Pixelle-Video/network/members"><img src="https://img.shields.io/github/forks/AIDC-AI/Pixelle-Video.svg" alt="Forks"></a> |
| 12 | <a href="https://github.com/AIDC-AI/Pixelle-Video/blob/main/LICENSE"><img src="https://img.shields.io/github/license/AIDC-AI/Pixelle-Video.svg" alt="License"></a> |
| 13 | </p> |
| 14 | |
| 15 | https://github.com/user-attachments/assets/a42e7457-fcc8-40da-83fc-784c45a8b95d |
| 16 | |
| 17 | <br/> |
| 18 | |
| 19 | 只需输入一个 **主题**,Pixelle-Video 就能自动完成: |
| 20 | - ✍️ 撰写视频文案 |
| 21 | - 🎨 生成 AI 配图/视频 |
| 22 | - 🗣️ 合成语音解说 |
| 23 | - 🎵 添加背景音乐 |
| 24 | - 🎬 一键合成视频 |
| 25 | |
| 26 | **零门槛,零剪辑经验**,让视频创作成为一句话的事! |
| 27 | |
| 28 | |
| 29 | ## 🖥️ Web 界面预览 |
| 30 | |
| 31 |  |
| 32 | |
| 33 | |
| 34 | ## 📋 最近更新 |
| 35 | |
| 36 | - ✅ **2026-06-01**: 新增直连 API 媒体模型配置,支持在 WebUI 中配置图像/视频模型供应商、Base URL 与代理开关 |
| 37 | - ✅ **2026-01-26**: 新增「动作迁移」模块,上传参考视频和图片进行动作迁移 |
| 38 | - ✅ **2026-01-14**: 新增「数字人口播」和「图生视频」流水线,新增多语言 TTS 音色支持 |
| 39 | - ✅ **2026-01-06**: 新增 RunningHub 48G 显存机器调用支持 |
| 40 | - ✅ **2025-12-28**: 支持 RunningHub 并发限制可配置,优化 LLM 返回结构化数据的逻辑 |
| 41 | - ✅ **2025-12-17**: 支持 ComfyUI API Key 配置,支持 Nano Banana 模型调用,API 接口支持模板自定义参数 |
| 42 | - ✅ **2025-12-10**: 侧边栏内置 FAQ,锁定 edge-tts 版本修复 TTS 服务不稳定问题 |
| 43 | - ✅ **2025-12-08**: 支持固定脚本多种分割方式(段落/行/句子),优化模板选择交互逻辑支持直接预览选择 |
| 44 | - ✅ **2025-12-06**: 修复视频生成 API 返回 URL 路径处理,支持跨平台兼容 |
| 45 | - ✅ **2025-12-05**: 新增 Windows 整合包下载,优化图片与视频反推工作流 |
| 46 | - ✅ **2025-12-04**: 新增「自定义素材」功能,支持用户上传自己的照片和视频,AI 智能分析生成脚本 |
| 47 | - ✅ **2025-11-18**: 优化 RunningHub 服务调用支持并行处理,新增历史记录页面,支持批量创建视频任务 |
| 48 | |
| 49 | |
| 50 | ## ✨ 功能亮点 |
| 51 | |
| 52 | - ✅ **全自动生成** - 输入主题,自动生成完整视频 |
| 53 | - ✅ **AI 智能文案** - 根据主题智能创作解说词,无需自己写脚本 |
| 54 | - ✅ **AI 生成配图** - 每句话都配上精美的 AI 插图 |
| 55 | - ✅ **AI 生成视频** - 支持使用 AI 视频生成模型(如 WAN 2.1)创建动态视频内容 |
| 56 | - ✅ **直连模型 API** - 可直接调用 DashScope、OpenAI、Seedream、Seedance、Kling 等图像/视频生成服务 |
| 57 | - ✅ **AI 生成语音** - 支持 Edge-TTS、Index-TTS 等众多主流 TTS 方案 |
| 58 | - ✅ **背景音乐** - 支持添加 BGM,让视频更有氛围 |
| 59 | - ✅ **视觉风格** - 多种模板可选,打造独特视频风格 |
| 60 | - ✅ **灵活尺寸** - 支持竖屏、横屏等多种视频尺寸 |
| 61 | - ✅ **多种 AI 模型** - 支持 GPT、通义千问、DeepSeek、Ollama 等 |
| 62 | - ✅ **原子能力灵活组合** - 支持 ComfyUI / RunningHub 工作流,也支持直连 API 模型,可按需替换图像、视频、TTS、VLM 等能力 |
| 63 | |
| 64 | |
| 65 | ## 📊 视频生成流程 |
| 66 | |
| 67 | Pixelle-Video 采用模块化设计,整个视频生成流程清晰简洁: |
| 68 | |
| 69 |  |
| 70 | |
| 71 | 从输入文本到最终视频输出,整个流程简洁清晰:**文案生成 → 配图规划 → 逐帧处理 → 视频合成** |
| 72 | |
| 73 | 每个环节都支持灵活定制,可选择不同的 AI 模型、音频引擎、视觉风格等,满足个性化创作需求。 |
| 74 | |
| 75 | |
| 76 | ## 🎬 视频示例 |
| 77 | |
| 78 | 以下是使用 Pixelle-Video 生成的实际案例,展示了不同主题和风格的视频效果: |
| 79 | |
| 80 | ### 📱 扩展模块视频展示 |
| 81 | |
| 82 | <table> |
| 83 | <tr> |
| 84 | <td width="33%"> |
| 85 | <h3>👤 数字人口播</h3> |
| 86 | <video src="https://github.com/user-attachments/assets/7c122563-c2e0-4dcd-a73c-25ba1d4fa2dd" controls width="100%"></video> |
| 87 | <p align="center"><b>韩语数字人口播</b></p> |
| 88 | </td> |
| 89 | <td width="33%"> |
| 90 | <h3>🖼️ 图生视频</h3> |
| 91 | <video src="https://github.com/user-attachments/assets/5b4eef17-07d0-4bde-9748-2ed68cc9888e" controls width="100%"></video> |
| 92 | <p align="center"><b>卡通视频</b></p> |
| 93 | </td> |
| 94 | <td width="33%"> |
| 95 | <h3>💃 动作迁移</h3> |
| 96 | <video src="https://github.com/user-attachments/assets/7b1240bc-e965-434c-b343-118ec4793d4f" controls width="100%"></video> |
| 97 | <p align="center"><b>跳舞小猫</b></p> |
| 98 | </td> |
| 99 | </tr> |
| 100 | </table> |
| 101 | |
| 102 | |
| 103 | ### 📱 竖屏视频展示 |
| 104 | |
| 105 | <table> |
| 106 | <tr> |
| 107 | <td width="33%"> |
| 108 | <h3>🌄 人文纪实类 - 视频默认模版</h3> |
| 109 | <video src="https://github.com/user-attachments/assets/e6716c1d-78de-453d-84c2-10873c8c595f" controls width="100%"></video> |
| 110 | <p align="center"><b>旅行路上的风景让人流连忘返</b></p> |
| 111 | </td> |
| 112 | <td width="33%"> |
| 113 | <h3>🔍 文化解构类 - 视频默认模版</h3> |
| 114 | <video src="https://github.com/user-attachments/assets/f5de75f6-135a-4ab4-9f5f-079f649764d5" controls width="100%"></video> |
| 115 | <p align="center"><b>Santa ID</b></p> |
| 116 | </td> |
| 117 | <td width="33%"> |
| 118 | <h3>🔭 科学思辨类 - 视频默认模版</h3> |
| 119 | <video src="https://github.com/user-attachments/assets/ceb8b0df-8331-4e1f-88e7-db5b295a1c1d" controls width="100%"></video> |
| 120 | <p align="center"><b>为什么我们还没有找到外星文明?</b></p> |
| 121 | </td> |
| 122 | </tr> |
| 123 | <tr> |
| 124 | <td width="33%"> |
| 125 | <h3>🌱 个人成长类 - 克隆音色</h3> |
| 126 | <video src="https://github.com/user-attachments/assets/1bad9a49-df83-4905-9cc8-9a7640e9c7d8" controls width="100%"></video> |
| 127 | <p align="center"><b>如何提升自己</b></p> |
| 128 | </td> |
| 129 | <td width="33%"> |
| 130 | <h3>🧠 深度思考类 - 默认模板</h3> |
| 131 | <video src="https://github.com/user-attachments/assets/663b705a-2aea-44bc-b266-4bb27aa255a8" controls width="100%"></video> |
| 132 | <p align="center"><b>如何理解反脆弱</b></p> |
| 133 | </td> |
| 134 | <td width="33%"> |
| 135 | <h3>🏯 历史文化类 - 固定画面</h3> |
| 136 | <video src="https://github.com/user-attachments/assets/56e0a018-fa99-47eb-a97f-fc2fa8915724" controls width="100%"></video> |
| 137 | <p align="center"><b>资治通鉴</b></p> |
| 138 | </td> |
| 139 | </tr> |
| 140 | <tr> |
| 141 | <td width="33%"> |
| 142 | <h3>☀️ 情感类 - 克隆音色</h3> |
| 143 | <video src="https://github.com/user-attachments/assets/4687df95-dd21-4a7b-b01e-f33a7b646644" controls width="100%"></video> |
| 144 | <p align="center"><b>冬日暖阳</b></p> |
| 145 | </td> |
| 146 | <td width="33%"> |
| 147 | <h3>📜 小说解说类 - 自创脚本</h3> |
| 148 | <video src="https://github.com/user-attachments/assets/d354465e-3fa8-40b4-93e9-61ad75ef0697" controls width="100%"></video> |
| 149 | <p align="center"><b>斗破苍穹</b></p> |
| 150 | </td> |
| 151 | <td width="33%"> |
| 152 | <h3>🧬 知识科普类 - Qwen生图</h3> |
| 153 | <video src="https://github.com/user-attachments/assets/8ac21768-41ce-4d41-acdd-e3dd3eb9725a" controls width="100%"></video> |
| 154 | <p align="center"><b>养生知识</b></p> |
| 155 | </td> |
| 156 | </tr> |
| 157 | </table> |
| 158 | |
| 159 | ### 🖥️ 横屏视频展示 |
| 160 | |
| 161 | <table> |
| 162 | <tr> |
| 163 | <td width="50%"> |
| 164 | <h3>💰 副业赚钱 - 电影模板</h3> |
| 165 | <video src="https://github.com/user-attachments/assets/c9209d4e-73a6-4b82-aaad-cf102248c9e2" controls width="100%"></video> |
| 166 | <p align="center"><b>副业赚钱</b></p> |
| 167 | </td> |
| 168 | <td width="50%"> |
| 169 | <h3>🏛️ 历史解说 - 自定义模板</h3> |
| 170 | <video src="https://github.com/user-attachments/assets/a767c452-d5f1-4cff-bb34-b80fff0d4c3e" controls width="100%"></video> |
| 171 | <p align="center"><b>资治通鉴启示录</b></p> |
| 172 | </td> |
| 173 | </tr> |
| 174 | </table> |
| 175 | |
| 176 | > 💡 **提示**: 这些视频都是通过输入一个主题关键词,由 AI 全自动生成的,无需任何视频剪辑经验! |
| 177 | |
| 178 | |
| 179 | <div id="tutorial-start" /> |
| 180 | |
| 181 | |
| 182 | ## 🚀 快速开始 |
| 183 | |
| 184 | ### 🪟 Windows 一键整合包(推荐 Windows 用户使用) |
| 185 | |
| 186 | **无需安装 Python、uv 或 ffmpeg,一键开箱即用!** |
| 187 | |
| 188 | 👉 **[下载 Windows 一键整合包](https://github.com/AIDC-AI/Pixelle-Video/releases/latest)** |
| 189 | |
| 190 | 1. 下载最新的 Windows 一键整合包并解压 |
| 191 | 2. 双击运行 `start.bat` 启动 Web 界面 |
| 192 | 3. 浏览器会自动打开 http://localhost:8501 |
| 193 | 4. 在「⚙️ 系统配置」中配置 LLM API 和图像生成服务 |
| 194 | 5. 开始生成视频! |
| 195 | |
| 196 | > 💡 **提示**: 整合包已包含所有依赖,无需手动安装任何环境。首次使用只需配置 API 密钥即可。 |
| 197 | |
| 198 | |
| 199 | ### 从源码安装(适合 macOS / Linux 用户或需要自定义的用户) |
| 200 | |
| 201 | #### 前置环境依赖 |
| 202 | |
| 203 | 在开始之前,需要先安装 Python 包管理器 `uv` 和视频处理工具 `ffmpeg`: |
| 204 | |
| 205 | ##### 安装 uv |
| 206 | |
| 207 | 请访问 uv 官方文档查看适合你系统的安装方法: |
| 208 | 👉 **[uv 安装指南](https://docs.astral.sh/uv/getting-started/installation/)** |
| 209 | |
| 210 | 安装完成后,在终端中运行 `uv --version` 验证安装成功。 |
| 211 | |
| 212 | ##### 安装 ffmpeg |
| 213 | |
| 214 | **macOS** |
| 215 | ```bash |
| 216 | brew install ffmpeg |
| 217 | ``` |
| 218 | |
| 219 | **Ubuntu / Debian** |
| 220 | ```bash |
| 221 | sudo apt update |
| 222 | sudo apt install ffmpeg |
| 223 | ``` |
| 224 | |
| 225 | **Windows** |
| 226 | - 下载地址:https://ffmpeg.org/download.html |
| 227 | - 下载后解压,将 `bin` 目录添加到系统环境变量 PATH 中 |
| 228 | |
| 229 | 安装完成后,在终端中运行 `ffmpeg -version` 验证安装成功。 |
| 230 | |
| 231 | |
| 232 | #### 第一步:下载项目 |
| 233 | |
| 234 | ```bash |
| 235 | git clone https://github.com/AIDC-AI/Pixelle-Video.git |
| 236 | cd Pixelle-Video |
| 237 | ``` |
| 238 | |
| 239 | #### 第二步:启动 Web 界面 |
| 240 | |
| 241 | ```bash |
| 242 | # 使用 uv 运行(推荐,会自动安装依赖) |
| 243 | uv run streamlit run web/app.py |
| 244 | ``` |
| 245 | |
| 246 | 浏览器会自动打开 http://localhost:8501 |
| 247 | |
| 248 | #### 第三步:在 Web 界面配置 |
| 249 | |
| 250 | 首次使用时,展开「⚙️ 系统配置」面板,填写: |
| 251 | - **LLM 配置**: 选择 AI 模型(如通义千问、GPT 等)并填入 API Key |
| 252 | - **ComfyUI / RunningHub 配置**: 如需使用工作流生成图片、视频或语音,配置本地 ComfyUI 地址或 RunningHub API Key |
| 253 | - **API 媒体模型配置**: 如需直连图像/视频模型,配置 DashScope、OpenAI、ARK、Kling 等供应商的 API Key、Base URL 和代理选项 |
| 254 | |
| 255 | 配置好后点击「保存配置」,就可以开始生成视频了! |
| 256 | |
| 257 | <div id="tutorial-end" /> |
| 258 | |
| 259 | ## 💻 使用方法 |
| 260 | |
| 261 | 打开 Web 界面后,你会看到三栏布局,下面详细讲解每个部分: |
| 262 | |
| 263 | |
| 264 | ### ⚙️ 系统配置(首次必填) |
| 265 | |
| 266 | 首次使用时需要配置,点击展开「⚙️ 系统配置」面板: |
| 267 | |
| 268 | #### 1. LLM 配置(大语言模型) |
| 269 | 用于生成视频文案的 AI。 |
| 270 | |
| 271 | **快速选择预设** |
| 272 | - 通过下拉菜单选择预设模型(通义千问、GPT-4o、DeepSeek 等) |
| 273 | - 选择后会自动填充 base_url 和 model |
| 274 | - 点击「🔑 获取 API Key」链接去注册并获取密钥 |
| 275 | |
| 276 | **手动配置** |
| 277 | - API Key: 填入你的密钥 |
| 278 | - Base URL: API 地址 |
| 279 | - Model: 模型名称 |
| 280 | |
| 281 | #### 2. ComfyUI / RunningHub 配置 |
| 282 | 用于通过 ComfyUI 工作流生成视频配图、视频片段或语音。 |
| 283 | |
| 284 | **本地部署(推荐)** |
| 285 | - ComfyUI URL: 本地 ComfyUI 服务地址(默认 http://127.0.0.1:8188) |
| 286 | - 点击「测试连接」确认服务可用 |
| 287 | |
| 288 | **云端部署** |
| 289 | - RunningHub API Key: 云端图像生成服务的密钥 |
| 290 | |
| 291 | #### 3. API 媒体模型配置 |
| 292 | 用于不依赖 ComfyUI/RunningHub,直接调用模型供应商的图像、视频或素材分析能力。 |
| 293 | |
| 294 | **支持的供应商** |
| 295 | - OpenAI / GPT Image:用于 GPT 图像生成模型 |
| 296 | - DashScope / Wan / HappyHorse:用于通义万象图像、视频生成 |
| 297 | - Volcengine ARK / Seedream / Seedance:用于字节 Seedream 图像和 Seedance 视频生成 |
| 298 | - Kling AI / 可灵:用于可灵视频生成 |
| 299 | |
| 300 | **可配置项** |
| 301 | - API Key / Access Key / Secret Key:模型供应商鉴权信息 |
| 302 | - Base URL:模型服务地址,WebUI 会提供官方默认地址 |
| 303 | - 本地代理:如 `http://127.0.0.1:9090` |
| 304 | - 启用代理:每个供应商可单独选择是否走本地代理 |
| 305 | - 打印模型请求参数:调试用,会在终端打印发送给模型的 prompt、模型名和输入文件路径 |
| 306 | |
| 307 | > 💡 如果你只使用 ComfyUI 或 RunningHub,可以不填写 API 媒体模型配置;如果你选择 `api/...` 工作流,则需要配置对应供应商的密钥。 |
| 308 | |
| 309 | 配置完成后点击「保存配置」。 |
| 310 | |
| 311 | |
| 312 | ### 📝 内容输入(左侧栏) |
| 313 | |
| 314 | #### 生成模式 |
| 315 | - **AI 生成内容**: 输入主题,AI 自动创作文案 |
| 316 | - 适合:想快速生成视频,让 AI 写稿 |
| 317 | - 例如:「为什么要养成阅读习惯」 |
| 318 | - **固定文案内容**: 直接输入完整文案,跳过 AI 创作 |
| 319 | - 适合:已有现成文案,直接生成视频 |
| 320 | |
| 321 | #### 背景音乐(BGM) |
| 322 | - **无 BGM**: 纯人声解说 |
| 323 | - **内置音乐**: 选择预置的背景音乐(如 default.mp3) |
| 324 | - **自定义音乐**: 将你的音乐文件(MP3/WAV 等)放到 `bgm/` 文件夹 |
| 325 | - 点击「试听 BGM」可以预览音乐 |
| 326 | |
| 327 | |
| 328 | ### 🎤 语音设置(中间栏) |
| 329 | |
| 330 | #### TTS 工作流 |
| 331 | - 从下拉菜单选择 TTS 工作流(支持 Edge-TTS、Index-TTS 等) |
| 332 | - 系统会自动扫描 `workflows/` 文件夹中的 TTS 工作流 |
| 333 | - 如果懂 ComfyUI,可以自定义 TTS 工作流 |
| 334 | |
| 335 | #### 参考音频(可选) |
| 336 | - 上传参考音频文件用于声音克隆(支持 MP3/WAV/FLAC 等格式) |
| 337 | - 适用于支持声音克隆的 TTS 工作流(如 Index-TTS) |
| 338 | - 上传后可以直接试听 |
| 339 | |
| 340 | #### 预览功能 |
| 341 | - 输入测试文本,点击「预览语音」即可试听效果 |
| 342 | - 支持使用参考音频进行预览 |
| 343 | |
| 344 | |
| 345 | ### 🎨 视觉设置(中间栏) |
| 346 | |
| 347 | #### 图像生成 |
| 348 | 决定 AI 生成什么风格的配图。 |
| 349 | |
| 350 | **ComfyUI 工作流** |
| 351 | - 从下拉菜单选择图像生成工作流 |
| 352 | - 支持本地部署(selfhost)和云端(RunningHub)工作流 |
| 353 | - 也支持选择 `api/...` 直连图像模型工作流(需先在系统配置中填写对应供应商密钥) |
| 354 | - 默认使用 `image_flux.json` |
| 355 | - 如果懂 ComfyUI,可以放自己的工作流到 `workflows/` 文件夹 |
| 356 | |
| 357 | **图像尺寸** |
| 358 | - 设置生成图像的宽度和高度(单位:像素) |
| 359 | - 默认 1024x1024,可根据需要调整 |
| 360 | - 注意:不同的模型对尺寸有不同的限制 |
| 361 | |
| 362 | **提示词前缀(Prompt Prefix)** |
| 363 | - 控制图像的整体风格(语言需要是英文的) |
| 364 | - 例如:Minimalist black-and-white matchstick figure style illustration, clean lines, simple sketch style |
| 365 | - 点击「预览风格」可以测试效果 |
| 366 | |
| 367 | #### 视频模板 |
| 368 | 决定视频画面的布局和设计。 |
| 369 | |
| 370 | **模板命名规范** |
| 371 | - `static_*.html`: 静态模板(无需AI生成媒体,纯文字样式) |
| 372 | - `image_*.html`: 图片模板(使用AI生成的图片作为背景) |
| 373 | - `video_*.html`: 视频模板(使用AI生成的视频作为背景) |
| 374 | |
| 375 | **使用方法** |
| 376 | - 从下拉菜单选择模板,按尺寸分组显示(竖屏/横屏/方形) |
| 377 | - 点击「预览模板」可以自定义参数测试效果 |
| 378 | - 如果懂 HTML,可以在 `templates/` 文件夹创建自己的模板 |
| 379 | - 🔗 [查看所有模板效果图](https://aidc-ai.github.io/Pixelle-Video/zh/user-guide/templates/#_3) |
| 380 | |
| 381 | #### API 视频生成 |
| 382 | 当选择支持动态视频的模板或扩展工作流时,可以使用直连 API 视频模型生成片段。 |
| 383 | |
| 384 | - 支持 DashScope Wan / HappyHorse、Kling、Seedance 等视频模型 |
| 385 | - 支持按模型能力显示分辨率、画幅比例、时长、水印、原生音频等参数 |
| 386 | - 支持网络下载重试与内容审核失败后的提示词中性化重试 |
| 387 | - 在「自定义素材」工作流中,API 视频片段会尽量根据旁白音频时长生成,并使用相邻片段信息提升连贯性 |
| 388 | |
| 389 | |
| 390 | ### 🎬 生成视频(右侧栏) |
| 391 | |
| 392 | #### 生成按钮 |
| 393 | - 配置好所有参数后,点击「🎬 生成视频」 |
| 394 | - 会显示实时进度(生成文案 → 生成配图 → 合成语音 → 合成视频) |
| 395 | - 生成完成后自动显示视频预览 |
| 396 | |
| 397 | #### 进度显示 |
| 398 | - 实时显示当前步骤 |
| 399 | - 例如:「分镜 3/5 - 生成插图」 |
| 400 | |
| 401 | #### 视频预览 |
| 402 | - 生成完成后自动播放 |
| 403 | - 显示视频时长、文件大小、分镜数等信息 |
| 404 | - 视频文件保存在 `output/` 文件夹 |
| 405 | |
| 406 | |
| 407 | ### ❓ 常见问题 |
| 408 | |
| 409 | **Q: 第一次使用需要多久?** |
| 410 | A: 生成时长取决于视频分镜数量、网络状况和 AI 推理速度,通常几分钟内即可完成。 |
| 411 | |
| 412 | **Q: 视频效果不满意怎么办?** |
| 413 | A: 可以尝试: |
| 414 | 1. 更换 LLM 模型(不同模型文案风格不同) |
| 415 | 2. 调整图像尺寸和提示词前缀(改变配图风格) |
| 416 | 3. 更换 TTS 工作流或上传参考音频(改变语音效果) |
| 417 | 4. 尝试不同的视频模板和尺寸 |
| 418 | |
| 419 | **Q: 费用大概多少?** |
| 420 | A: **本项目完全支持免费运行!** |
| 421 | |
| 422 | - **完全免费方案**: LLM 使用 Ollama(本地运行)+ ComfyUI 本地部署 = 0 元 |
| 423 | - **推荐方案**: LLM 使用通义千问(成本极低,性价比高)+ ComfyUI 本地部署 |
| 424 | - **云端方案**: LLM 使用 OpenAI + 图像使用 RunningHub(费用较高但无需本地环境) |
| 425 | |
| 426 | **选择建议**:本地有显卡建议完全免费方案,否则推荐使用通义千问(性价比高) |
| 427 | |
| 428 | |
| 429 | ## 🤝 参考项目 |
| 430 | |
| 431 | Pixelle-Video 的设计受到以下优秀开源项目的启发: |
| 432 | |
| 433 | - [Pixelle-MCP](https://github.com/AIDC-AI/Pixelle-MCP) - ComfyUI MCP 服务器,让 AI 助手直接调用 ComfyUI |
| 434 | - [MoneyPrinterTurbo](https://github.com/harry0703/MoneyPrinterTurbo) - 优秀的视频生成工具 |
| 435 | - [NarratoAI](https://github.com/linyqh/NarratoAI) - 影视解说自动化工具 |
| 436 | - [MoneyPrinterPlus](https://github.com/ddean2009/MoneyPrinterPlus) - 视频创作平台 |
| 437 | - [ComfyKit](https://github.com/puke3615/ComfyKit) - ComfyUI 工作流封装库 |
| 438 | |
| 439 | 感谢这些项目的开源精神!🙏 |
| 440 | |
| 441 | |
| 442 | ## 💬 社区交流 |
| 443 | |
| 444 | 扫描下方二维码加入我们的社区,获取最新动态和技术支持: |
| 445 | |
| 446 | | 微信群 | Discord 社区 | |
| 447 | | ---- | ---- | |
| 448 | | <img src="resources/wechat.png" alt="微信交流群" width="250" /> | <img src="resources/discord.png" alt="Discord 社区" width="250" /> | |
| 449 | |
| 450 | |
| 451 | ## 📢 反馈与支持 |
| 452 | |
| 453 | - 🐛 **遇到问题**: 提交 [Issue](https://github.com/AIDC-AI/Pixelle-Video/issues) |
| 454 | - 💡 **功能建议**: 提交 [Feature Request](https://github.com/AIDC-AI/Pixelle-Video/issues) |
| 455 | - ⭐ **给个 Star**: 如果这个项目对你有帮助,欢迎给个 Star 支持一下! |
| 456 | |
| 457 | |
| 458 | ## 📝 许可证 |
| 459 | |
| 460 | 本项目采用 Apache 2.0 许可证,详情请查看 [LICENSE](LICENSE) 文件。 |
| 461 | |
| 462 | |
| 463 | ## 📚 系列工作 |
| 464 | |
| 465 | | 框架图 | 论文信息 | |
| 466 | |:---:|---| |
| 467 | | <img src="https://github.com/HITsz-TMG/VideoClaw/blob/main/FilmAgent-pics/framework.png" width="420" alt="FilmAgent framework"/> | **[SIGGRAPH Asia 2024] FilmAgent: Automating Virtual Film Production Through a Multi-Agent Collaborative Framework**<br>*Zhenran Xu, Longyue Wang, Jifang Wang, Zhouyi Li, Senbao Shi, Xue Yang, Yiyu Wang, Baotian Hu, Jun Yu, Min Zhang*<br>[[Paper](https://arxiv.org/pdf/2501.12909)] [[GitHub](https://github.com/HITsz-TMG/VideoClaw/blob/main/FilmAgent)] | |
| 468 | | <img src="https://github.com/HITsz-TMG/Anim-Director/blob/main/Anim-Director/assets/visualeg.png" width="420" alt="Anim-Director result"/> | **[SIGGRAPH Asia 2024] Anim-Director: A Large Multimodal Model Powered Agent for Controllable Animation Video Generation**<br>*Yunxin Li, Haoyuan Shi, Baotian Hu, Longyue Wang, Jiashun Zhu, Jinyi Xu, Zhen Zhao, Min Zhang*<br>[[Paper](https://doi.org/10.1145/3680528.3687688)] [[GitHub](https://github.com/HITsz-TMG/Anim-Director/tree/main/Anim-Director)] | |
| 469 | | <img src="https://github.com/AIDC-AI/ComfyUI-Copilot/blob/main/assets/Framework-v3.png" width="420" alt="Anim-Director result"/> | **[ACL 2025] ComfyUI-Copilot: An Intelligent Assistant for Automated Workflow Development**<br>*Zhenran Xu, Xue Yang, Yiyu Wang, Qingli Hu, Zijiao Wu, Longyue Wang, Weihua Luo, Kaifu Zhang, Baotian Hu, Min Zhang*<br>[[Paper](https://aclanthology.org/2025.acl-demo.61/)] [[GitHub](https://github.com/AIDC-AI/ComfyUI-Copilot)] | |
| 470 | | <img src="https://raw.githubusercontent.com/HITsz-TMG/Anim-Director/main/AniMaker/assets/pipeline.png" width="420" alt="AniMaker pipeline"/> | **[SIGGRAPH Asia 2025] AniMaker: Multi-Agent Animated Storytelling with MCTS-Driven Clip Generation**<br>*Haoyuan Shi, Yunxin Li, Xinyu Chen, Longyue Wang, Baotian Hu, Min Zhang*<br>[[Paper](https://doi.org/10.1145/3757377.3764009)] [[GitHub](https://github.com/HITsz-TMG/Anim-Director/tree/main/AniMaker)] | |
| 471 | |
| 472 | |
| 473 | |
| 474 | ## ⭐ Star History |
| 475 | |
| 476 | [](https://star-history.com/#AIDC-AI/Pixelle-Video&Date) |
| 477 |