Open Generative AI:免费开源的 AI 图像与视频生成工作室,400+ 模型完整指南 Open Generative AI免费开源的 AI 图像与视频生成工作室400 模型完整指南【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI商业 AI 视频平台经常拒掉你的提示词还要你月付 10 到 120 美元。Open Generative AI 是个免费的开源 AI 图像与视频生成工作室400 模型覆盖 Flux、Kling、Sora、Veo可自托管、无内容过滤MIT 协议。值不值得试先看三组对比费用Midjourney 约 $10–$120/月、Runway 约 $12–$76/月的订阅制这里是开源免费无订阅费过滤商业平台会拦截或改写提示词这里无内容过滤、无提示词拒答数据自托管模式下你的上传与生成记录留在本机存于浏览器 localStorage对比项闭源平台Open Generative AI费用$8–$120/月不等免费MIT 协议模型数单一自家模型400覆盖 8 大类参考图上限有限单次最多 14 张本地推理无内置 sd.cpp 引擎桌面版可用5 分钟跑起来三条路径任选其一在线版浏览器打开官方托管地址注册免费账号即可用全部工作室无需装 Node.js模型始终最新桌面应用v1.0.9 提供 macOSApple Silicon / Intel、Windows x64、LinuxAppImage / .deb一键安装包。macOS 首次启动被 Gatekeeper 拦截属正常现象执行一次xattr -cr即可Windows SmartScreen 提示点仍要运行源码部署需要 Node.js 18git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup npm run devnpm run setup会初始化子模块并构建 packages/ 下的 studio、workflow、agents 工作区只跑npm install是不够的。启动后进入 http://localhost:3000桌面版则用npm run electron:dev。用文字生成 AI 图像的最短路径只输入文字时图像工作室自动挂上50 个文本到图像模型Flux Dev、Nano Banana 2、Seedream 5.0、Midjourney v7、GPT-4o 都在列表里。Nano Banana 2支持 1K/2K/4K 分辨率带 Google 搜索增强宽高比可设autoSeedream 5.0字节跳动basic/high 两档质量、8 种宽高比、最高 4KMiniMax Image 01一次请求最多出 4 张图提示词支持 1500 字符界面里的宽高比、分辨率、时长选择器是动态的——切到哪个模型就只显示那个模型支持的参数不会选错。所有生成结果存在本地历史里可一键下载原图。一次带 14 张参考图批量改图怎么做上传 1 张参考图界面自动切到55 个图像到图像模型。选中支持多参考图的模型如 Nano Banana 2 Edit后上传控件会直接变成多选模式每张图带顺序编号按你勾选的顺序发给模型支持批量勾选文件点Use Selected一次确认上传过的图存在本地历史3 列网格直接复用不用重复上传各模型参考图上限差异较大模型上限Nano Banana 2 Edit14Nano Banana Edit / Flux Kontext Dev / Kling O1 / GPT-4o Edit / Seedream Edit v410Vidu Q2 Reference to Image7Flux 2 Flex/Pro Edit8Qwen Image Edit Plus3适用场景把产品图 多张风格参考一起喂进去做风格融合或用旧图 新元素批量改版式。用文字生成 AI 视频40 文生视频模型没有首帧素材就直接文字生成视频可选40 个文本到视频模型Kling v3、Sora 2、Veo 3、Wan 2.6、Runway Gen-3、Hailuo 2.3。Seedance 2.0字节跳动5 / 10 / 15 秒三档时长16:9 / 9:16 / 4:3 / 3:4basic/high 质量还带 Extend 模式给已有视频无缝续写Grok Imagine T2VxAI最长 15 秒fun / normal / spicy 三种运动风格MiniMax HailuoFull HD 输出带快速变体上传首帧图片后自动切到60 个图生视频模型Kling I2V、Veo3 I2V、Runway I2V、Seedance 2.0 I2V后者单次最多带 9 张参考图。任务提交后在历史区轮询结果刷新页面未完成的任务会自动恢复。把静态照片变成会说话的视频口型同步想让一张肖像开口说话Lip Sync Studio 有9 个专用模型分两种输入模式肖像图 音频上传照片和音频生成 480p / 720p / 1080p 讲话视频。可选 Infinite Talk、Wan 2.2 Speech to Video、LTX 2.3 Lipsync支持到 1080p、LTX 2 19B Lipsync均可附加提示词引导动作风格视频 音频给已有视频重新对口型适合配音换语言。可选 Sync、LatentSync、Creatify、Veed、Infinite Talk V2V生成记录单独存在lipsync_history刷新后同样自动续上。深挖独家功能Cinema Studio 的虚拟相机参数Cinema Studio 不让你调滑块而是给你一套虚拟相机把选择翻译成优化过的提示词修饰符喂给模型。怎么操作选机身6 种可选从 Modular 8K Digital 到 Classic 16mm Film选镜头11 种如 70s Cinema Prime、Swirl Bokeh Portrait、Extreme Macro、Clinical Sharp Prime选焦距8mm超广角/ 14mm / 24mm / 35mm / 50mm / 85mm选光圈f/1.4浅景深、f/4均衡、f/11深焦输入场景提示词点击生成能得到什么70s Cinema Prime f/1.4 85mm会直接产出带复古胶片光晕的浅景深人像换 Clinical Sharp Prime f/11 则是前后景全清晰的产品镜头。你不需要懂摄影术语界面把每个选项都标了用途。适合谁用做广告分镜、预告片概念图、或想统一一组图的镜头语言但又不想学相机设置的人。跟着做完一次文字到会说话的成品视频图像工作室输入场景描述选 Nano Banana 2分辨率 4K、宽高比 16:9 → 得到一张人物静帧视频工作室把这张静帧设为首帧选 Kling I2V生成 5 秒 → 得到基础动态片段Lip Sync Studio切到肖像模式上传同一张人物图 一段录音选 LTX 2.3 Lipsync、1080p → 得到口型与音频对齐的成品每步结果都留在各自的历史区里中途刷新不丢任务。想固化这套流程打开 Workflow Studio用拖拽节点把图像、视频、音频模型串成流水线有内置模板和社区工作流可直接运行建好的流程还能通过 Muapi API 调用。硬件与配置速查配置建议最低8 GB 内存本地推理只跑 SD 1.5 级模型Dreamshaper 8 / Realistic Vision v5.1各 2.1 GB推荐16 GB 内存Z-Image 权重 7.4 GB 约 2.4 GB 计算缓冲Apple Silicon 用 MetalWin/Linux 用 CUDA / Vulkan / ROCm常见坑8 GB 的 M 系列 Mac 跑 Z-Image 会卡死系统官方明确警告请改用 SD 1.5 模型本地推理只在桌面版可用托管网页版一律走云端 APIsd.cpp 引擎在Settings → Local Models里一键安装模型默认存在应用数据目录设环境变量OPEN_GENERATIVE_AI_LOCAL_AI_DIR可把几 GB 权重挪到其他磁盘M2 上 SD 1.5 正常速度约 1–2 秒/步若变成约 10 秒/步说明回退到了 CPU重装引擎即可排查本地引擎问题从终端启动应用日志会直接打到控制台Ubuntu 24.04 上 AppImage 启动失败时建议直接装.debFAQQ没有本地 GPU 能用吗A能。在线版和桌面版默认走云端 APIsd.cpp 也能跑 CPU 模式只是慢。想要视频级本地模型Wan 2.2 等才需要一台带 CUDA/ROCm 的 GPU 服务器接 Wan2GP。Q自托管版本真的没有任何内容过滤A是的这是项目的设计目标——无过滤器、无提示词拒答。生成什么由你输入的提示词和所选模型决定。Q一定要买 API 密钥吗A云端模型需要 Muapi.ai 的访问密钥在应用内粘贴即可如果只用本地推理模型SD 1.5 / SDXL / Z-Image可以跳过密钥。Q参考图会重复上传吗A不会。每张图只上传一次之后存在本地历史里跨会话直接复用。Q生成记录存在哪A浏览器 localStorage按工作室分开存口型同步单独存lipsync_history可回看、下载、删除。Open Generative AI 是目前能免费自托管、且模型池足够大的 AI 图像与视频生成工作台。去 5 分钟跑起来那一节挑一条路径今天就能出第一张图、第一段视频。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考