尧图网络 高端网站定制 · 原创设计
免费咨询热线
400-888-6620
免费获取方案
Pixelle-Video 快速上手指南:只输入一个主题,5 分钟生成完整 AI 短视频
Pixelle-Video 快速上手指南只输入一个主题5 分钟生成完整 AI 短视频【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-VideoPixelle-Video 是一款开源的 AI 全自动短视频引擎输入一个主题它会自动完成文案撰写、AI 配图、语音合成、背景音乐和最终视频合成全程不需要剪辑软件。适合想批量生产口播、科普、书单类短视频但没有剪辑经验的个人创作者和小团队也适合想接入 API 做自动化内容流水线的开发者。5 分钟跑通安装、配置、启动启动前只需准备两个依赖Python 包管理器uv和视频处理工具ffmpegmacOS 用brew install ffmpegUbuntu 用sudo apt install ffmpeg。git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py浏览器会自动打开http://localhost:8501。Windows 用户可以直接下载 Releases 里的一键整合包解压后双击start.bat即可无需安装 Python 和 ffmpeg。首次使用要展开「⚙️ 系统配置」面板填三组信息LLM 配置选预设通义千问、GPT-4o、DeepSeek、Ollama 本地模型会自动填充base_url和model再填 API KeyComfyUI / RunningHub 配置本地部署填 ComfyUI 地址默认http://127.0.0.1:8188云端则填 RunningHub API KeyAPI 媒体模型配置不依赖 ComfyUI 时直连 OpenAI、DashScope、火山 ARKSeedream/Seedance、可灵等供应商的图像/视频服务配置也可写在 config.example.yaml复制为config.yaml填写。保存后即可开始生成。跟着走一遍核心流程从「主题」到成片整条流水线是「文案生成 → 配图规划 → 逐帧处理 → 视频合成」以生成一个主题为「为什么要养成阅读习惯」的视频为例内容输入左侧栏选「AI 生成内容」模式输入主题默认生成 5 个分镜数量可调语音设置中间栏TTS 工作流默认 Edge-TTS 即可无需任何配置视觉设置中间栏图像工作流默认image_flux.json图像尺寸默认 1024x1024视频模板选1080x1920/image_default.html竖屏点「 生成视频」右侧栏实时显示进度如「分镜 3/5 - 生成插图」5 分镜视频通常 2-5 分钟出片预览与导出成片自动播放并显示时长、文件大小、分镜数视频文件保存在output/文件夹如果对文案不满意可以改用「固定文案内容」模式直接粘贴自己的稿子跳过 AI 创作环节固定脚本支持按段落、行、句子三种方式分割成分镜。核心能力拆解文案生成两种模式AI 生成内容LLM 根据主题写完整解说词支持所有 OpenAI 兼容接口的模型。换不同模型文案风格会有明显差异固定文案内容跳过创作直接用自己的稿子适合已有成熟脚本的账号图像与视频生成工作流 直连 API 双通道原子能力可以按需替换。图像生成走 ComfyUI 工作流workflows/ 下分runninghub/云端和selfhost/本地两套或api/...直连供应商两种方式内置 Flux、SDXL、Qwen、Seedream 等方案视频生成内置 Wan 2.1/2.2 工作流如video_wan2.1_fusionx.json也支持直连 DashScope、可灵、Seedance。图像风格靠「提示词前缀」控制英文描述如Minimalist black-and-white matchstick figure style illustration点「预览风格」可先试一张图再全量生成。语音合成Edge-TTS 起步支持克隆音色TTS 工作流自动扫描 workflows/ 目录内置 Edge-TTS免费、无需部署和 Index-TTS 等。选中支持克隆的工作流后上传一段 MP3/WAV 参考音频上传后可直接试听预览再做最终合成。多语言 TTS 音色开箱可用。模板系统30 个内置模板按尺寸分组模板用 HTML 定义画面位于 templates/ 目录按前缀区分三类前缀是否消耗 AI 算力适用场景static_*.html否纯文字渲染金句卡、公告生成极快image_*.html每分镜生成 1 张图图文口播、书单、科普video_*.html每分镜生成 1 段视频动态画面表现力最强数量上竖屏 1080x1920 有 24 个模板抖音、快手、小红书横屏 1920x1080 有 5 个B 站、YouTube方形 1080x1080 有 1 个。模板支持{{ title }}、{{ text }}、{{ image }}三个 Jinja2 变量会一点 HTML 就能复制现有模板改出自己的样式。背景音乐把 MP3/WAV 丢进bgm/文件夹即可被选中支持试听。进阶玩法数字人口播生成虚拟人物讲解视频支持多语言项目演示中有韩语数字人案例适合课程推广动作迁移上传参考视频和图片把参考视频中的动作迁移到新角色上如跳舞小猫案例图生视频选video_*模板或动态工作流用 Wan 2.1 等模型把静态画面变成动态片段自定义素材上传自己的照片和视频AI 智能分析素材后生成匹配脚本API 视频片段会尽量按旁白时长对齐批量与历史侧边栏历史记录页支持批量创建视频任务RunningHub 并发数可在runninghub_concurrent_limit里调到 1-10REST APIapi/ 目录下提供完整的 FastAPI 服务api/app.py涵盖内容、图像、TTS、视频、任务等路由方便第三方系统集成Docker 部署仓库提供 Dockerfile 和 docker-compose.yml常见问题FAQQ必须要部署 ComfyUI 吗不一定。纯文字模板static_*完全不需要要 AI 配图但不想本地部署可用 RunningHub 云端或直连 API 供应商本地有显卡才建议自托管 ComfyUI。Q跑一次要花多少钱有三档方案Ollama本地 LLM 本地 ComfyUI 0 元通义千问 本地 ComfyUI 约 0.01-0.05 元/视频性价比最高OpenAI RunningHub 全云端最省事但费用最高。Q生成慢、卡在哪一步看右侧进度条定位文案慢多半是 LLM 响应配图慢看图像工作流的网络和算力合成阶段检查本机 ffmpeg 是否正常。5 分镜参考耗时 2-5 分钟。QComfyUI 连接失败怎么办先确认本地 ComfyUI 服务已启动再核对 URL默认http://127.0.0.1:8188Docker 环境下 Mac/Windows 要用host.docker.internal:8188最后在 Web 界面点「测试连接」验证。Q成片效果不满意怎么调按顺序试换 LLM 模型改文案风格 → 改提示词前缀和图像尺寸换配图 → 换 TTS 工作流或传参考音频换声音 → 换模板和画幅。四个环节互相独立改哪个都不影响其他设置。小结与资源导航Pixelle-Video 把「文案、配图、配音、合成」四件事拆成可替换的模块你只需要在 Web 界面上选预设、填 Key、点生成。上手路径建议先用 Edge-TTS 云端图像服务跑通第一条竖屏视频再逐步替换成自己偏好的模型和模板。关键入口使用文档与教程docs/zh/含 快速开始、配置说明、FAQ配置示例config.example.yaml模板目录与效果图templates/、docs/zh/user-guide/templates.mdAI 工作流RunningHub / 自托管workflows/REST API 入口api/app.py社区与反馈README 中的微信群 / Discord 二维码或直接向仓库提交 Issue【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED

相关推荐

G-Helper:一个EXE替代华硕奥创的轻量笔记本控制工具

G-Helper:一个EXE替代华硕奥创的轻量笔记本控制工具

G-Helper:一个EXE替代华硕奥创的轻量笔记本控制工具 【免费下载链接】g-helper Lightweight Armoury Crate alternative for Asus laptops with nearly the same functionality. Works with ROG Zephyrus, Flow, TUF, Strix, Scar, ProArt, Vivobook, Zenbook, Expe…

📅 2026/9/30 1:51:36
大模型开发框架的演进趋势:从胶水层到标准化基础设施

大模型开发框架的演进趋势:从胶水层到标准化基础设施

大模型开发框架的演进趋势:从胶水层到标准化基础设施在大模型(LLM)与生成式 AI 应用爆发的初期,以 LangChain、LlamaIndex 为代表的开源开发框架迅速风靡全球。 在那个百家争鸣的探索阶段,这些框架的核心价值在于充当*…

📅 2026/9/30 1:46:36
分布式共识网络分区自愈实战:从脑裂防御到数据自动对齐

分布式共识网络分区自愈实战:从脑裂防御到数据自动对齐

分布式共识网络分区自愈实战:从脑裂防御到数据自动对齐在跨数据中心、多地域部署的分布式共识系统(如 Raft、Multi-Paxos 集群)中,网络分区(Network Partition / Split-Brain) 是最残酷、破坏力最大的物理故…

📅 2026/9/30 1:46:36
MORE NEWS

更多资讯

📰

Python后端AI专题33:评估召回与答案质量:Recall@K、MRR、nDCG 和引用正确率

Python后端AI专题33:评估召回与答案质量:RecallK、MRR、nDCG 和引用正确率回答错了,可能是相关 chunk 没召回、召回了却排太后、模型没使用证据,或引用了错误来源。只看“答案准确率 80%”无法定位该修分块、Embedding、Rerank 还…

📰

SAP单SQL语句导致HANA内存溢出:从告警到修复的完整排查实战

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

📰

【更新至2025年】2000-2025年上市公司管理层治理能力指标数据

【更新至2025年】2000-2025年上市公司管理层治理能力指标数据 1、时间:2000-2025年 2、来源:上市公司年报 3、指标:证券代码、证券简称、统计截止日期、行业代码、行业名称、行业代码1、行业名称1、产权性质、实际控制人拥有上市公司所有权…

📰

eVTOL低空经济无人机AI图像处理系统:从方案到工程落地

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

📰

全栈嵌入式开发:从MCU到云端的系统思维

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

📰

Nightingale Meraki 接入:最小配置 3 步跑通与限流避坑指南

Nightingale Meraki 接入:最小配置 3 步跑通与限流避坑指南 【免费下载链接】nightingale Nightingale is to monitoring and alerting what Grafana is to visualization. 项目地址: https://gitcode.com/GitHub_Trending/ni/nightingale 新接入的 Meraki 网…

TODAY

今日更新

THIS WEEK

本周精选

THIS MONTH

本月热门

读完文章,想聊聊您的网站?

告诉我们您的行业与需求,资深顾问一对一梳理方案与报价,全程免费。

📞 💬