Pixelle-Video AI短视频生成上手手册:从一句主题到成片出街

Pixelle-Video AI短视频生成上手手册:从一句主题到成片出街
Pixelle-Video AI短视频生成上手手册从一句主题到成片出街【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video把一段产品文案丢进工具拿回一条可直接发布的竖屏短视频。Pixelle-Video 是一个 AI 全自动短视频引擎文案、画面、配音、合成全部自动跑完。读完这份实操手册你能从零启动它并产出第一条成片。 Pixelle-Video 是什么适合谁它接管的是「有主题」到「有视频」之间全部琐碎环节LLM 写解说词ComfyUI 工作流或直连 API 模型出配图和片段TTS 引擎产出人声HTML 模板拼出最终画面。操作全部在 Streamlit 的 Web 界面里完成左侧内容输入、中间语音与视觉设置、右侧生成控制三栏分工。适合要批量产出短视频、但没有剪辑经验的自媒体运营、教育工作者、企业营销人员懂 ComfyUI 或 HTML/CSS想把自己的模型、工作流、模板接进流水线的人不太适合需要逐帧精修转场、音效和关键帧的人——它按分镜粒度合成不是时间线剪辑器既无法部署 ComfyUI、又不想走云端按量付费的部署环境 能力拆解从写脚本到出片的四个动作按实际动作把流水线拆开每一步的选型都相互独立可以单独替换。✍️ 写脚本两种输入模式文案环节有两条入口「AI 生成内容」只输主题例如为什么要养成阅读习惯解说词由 LLM 写「固定文案内容」直接粘贴现成稿件跳过 AI 创作固定脚本还能按段落、行或句子三种粒度分割。LLM 兼容任意 OpenAI SDK 接口预设了通义千问、GPT-4o、DeepSeek也可以指向本地 Ollama换模型即换文风。️ 选画面配图来自三路每个分镜对应一张图或一段动态片段来源三选一本地 ComfyUI 工作流selfhost 目录、RunningHub 云端默认 image_flux.json无需本地环境、直连模型 APIDashScope、OpenAI、Seedream、ARK/Seedance、Kling。图像尺寸默认 1024×1024、可调风格由英文提示词前缀统一控制界面上有「预览风格」可以先试。成片画幅分 1080×1920 竖屏、1920×1080 横屏、1080×1080 方形三档模板也按这三档归类。️ 配声音两路 TTS 加背景音乐TTS 工作流由系统自动扫描 workflows/ 目录生成下拉列表默认 Edge-TTSselfhost/tts_edge.jsonIndex-TTS 则支持上传参考音频MP3/WAV/FLAC克隆音色也可选多语言音色。正式生成前可以输入测试文本点「预览语音」试听。背景音乐三档关闭、选内置曲目、或把自己的 MP3 放进 bgm/ 目录。 出片一键合成与进度可见点「生成视频」后按 文案 → 逐分镜配图 → 语音 → 合成 的顺序执行界面滚动显示分镜 3/5 - 生成插图这类进度完成后自动播放并给出时长、文件大小、分镜数。成片落在 output/ 目录侧边栏的历史记录页可以回看旧作也支持批量建多个任务。 第一次运行从零到第一条成片Windows 用户走最短路径下载官方整合包、解压、双击 start.bat浏览器自动打开 Web 界面——依赖全部内置不用装 Python、uv、ffmpeg。macOS / Linux 用户先装好 uv 和 ffmpeg然后执行git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py启动后展开「⚙️ 系统配置」完成首配选一个 LLM 预设如通义千问并填 API Key走工作流路线就填本地 ComfyUI 地址默认 http://127.0.0.1:8188并点「测试连接」或填 RunningHub 密钥只有用直连模型时才需在 API 媒体模型配置里补对应供应商的密钥、Base URL 和代理开关。保存后输入主题、挑模板、选 TTS点生成——5 个分镜的视频通常几分钟内完成。花费按预算分三档完全免费Ollama 本地跑 LLM 本地 ComfyUI0 元高性价比通义千问 API 本地 ComfyUI文案成本极低全云端OpenAI RunningHub无需本地显卡但按调用付费。 自定义与进阶换工作流、做模板、接扩展管线跑通一遍后会发现模型、画面、声音这三层全是可替换的文件级配置。 换工作流三种原子能力可替换workflows/ 下 runninghub/ 放云端工作流、selfhost/ 放本地工作流系统启动时自动扫描。把自己的 ComfyUI json 丢进去即可替换生图模型FLUX、SD3.5 等或新增 TTS 方案走直连 API 的图像/视频/TTS/VLM 能力则按 config.example.yaml 中 api_providers 一节的字段填好密钥后启用。 做自己的模板HTMLCSS按尺寸归档预置模板都在 templates/按 1080x1920/、1920x1080/、1080x1080/ 三个尺寸目录组织。会写 HTML/CSS 的话按 static_纯文字、image_AI 图背景、video_*AI 片段背景的命名规则新增一个 html 文件界面下拉菜单就会直接列出它参数可在「预览模板」里微调。 扩展管线数字人、图生视频、动作迁移标准流水线之外还有四套入口digital_human数字人口播、i2v图生视频、action_transfer上传参考视频做动作迁移、asset_based上传自有照片/视频AI 分析后生成脚本工作流见 runninghub/ 下的 digital_*.json、video_understanding.json实现代码在 web/pipelines/。⚙️ 直接改配置文件config.yaml复制 config.example.yaml 为 config.yaml注意别提交进 Git就能绕过页面改配置llm 段填任意 OpenAI 兼容服务的 base_url 与 modelcomfyui 段管 comfyui_url、runninghub_api_key、并发上限以及 image / video / tts 三项默认工作流template.default_template 指定默认模板。 谁该用它怎么用如果你是日更抖音、小红书、快手的运营用固定文案模式 固定模板分镜控制在 3-5 个一条视频几分钟跑完批量任务一起排。如果你是教师或科普博主知识主题直接丢给 LLM 拆条讲解每段自动配 AI 插图写稿和设计两步都省掉。如果你是小微企业做内部宣传用 Index-TTS 加参考音频克隆公司统一音色产品介绍、使用教程长期复用这套声音资产。如果你做个人 IP按内容属性选对应模板治愈系、商务风、赛博霓虹保持视觉口吻一致没有本地显卡就用全云端方案。⚠️ 常见坑与解法配音生成失败——现象是 TTS 环节报错或产出不完整多为网络中断或云端工作流额度问题。先把默认的 selfhost/tts_edge.json 切到其他工作流试试再检查网络克隆音色时换成更清晰的参考音频。文案风格不对味——不同 LLM 的文风差异明显解说词AI 味重就先换模型比如从 GPT-4o 换到通义千问或 DeepSeek或者直接改用固定文案模式自己写稿。配图风格跑偏——提示词前缀要求英文书写尺寸由图像参数决定默认 1024×1024。效果不好时先用「预览风格」验证前缀写法再考虑换生图模型FLUX、Qwen、SD3.5。出片速度慢——主要变量是分镜数量和远程推理延迟。分镜压到 3-5 个服务尽量走本地 ComfyUI图像尺寸不要开过大整体耗时会明显缩短。模板选不到想要的——模板和画幅强绑定竖屏视频选不到横屏模板。先按界面里的竖屏/横屏/方形分组筛选再谈风格偏好。 先跑通最小任务挑主题如何养成阅读习惯其余全部保持默认竖屏 image_default 模板 Edge-TTS点一次生成。第一次的目标只是跑通核对解说词、配图风格和音色三处再逐项调整——换 LLM、改提示词前缀、换模板。细节查 docs/zh/index.md全部模板效果图在 templates/ 目录里对照着选。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

最新新闻

日新闻

周新闻

月新闻