
Open Generative AIAI 视频生成工作室400模型【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI付费的 AI 视频平台都有同款套路按月订阅、提示词被拒、生成次数受限。Open Generative AI 把这类工作室搬回你自己的机器上它是一个可自托管的 AI 视频生成与图像生成工作室把 Flux、Kling、Sora、Veo 等 400 多个模型放进同一套界面MIT 许可无内容过滤器。项目速览这个项目最值得说的不是功能多而是模型量大 可自托管 无过滤的组合。和商用平台比差异点很具体MIT 许可完全自托管源码公开可改API key 只存在浏览器 localStorage生成历史和上传记录都留本地不依赖某个厂商的云。8 大类 400 模型文生视频 85、图生视频 120、文生图 70、图生图 70、唇形同步 15 个README 里的数字都是对着模型定义文件核对过的。无内容过滤器没有提示词拒绝和护栏机制输什么提示词就按什么提示词生成这是项目主打的卖点。多图参考输入兼容的编辑模型一次可喂 14 张参考图支持批量上传和顺序编号做角色一致性很实用。本地推理能用桌面端内置 sd.cpp 引擎跑图像模型也可以连自建 Wan2GP GPU 服务器跑 Wan 2.2、LTX 这类视频模型。工作室主界面图像、视频、唇形同步、影院等 14 个 studio 共享同一套模型库一句话定位如果你需要一次试很多家视频模型或者对数据隐私有硬要求它是首选只是随手出图的话商用平台的学习成本更低。 快速上手从在线到本地的三条路径第一级零安装。项目提供托管的在线版本浏览器里直接进全部 studio注册免费账号就能用不用装 Node.js而且模型列表跟着最新走。第二级桌面应用。macOSApple Silicon 和 Intel 各一个 DMG、Windowsexe是一键安装包Linux 用 AppImage 或 .deb都在项目 Releases 里。macOS 首次启动会被 Gatekeeper 拦终端跑一次下面这条即可xattr -cr /Applications/Open Generative AI.app之后右键应用选打开就行Windows 遇到 SmartScreen 警告点仍要运行。第三级源码跑起来。需要 Node.js 18以及一个 Muapi.ai 的 API key只用本地模型的话可以先跳过。克隆后启动git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup npm run electron:devnpm run dev跑的是 Next.js Web 版起在 localhost:3000。注意子模块那步不能省workflow 和 agent 两个包在子模块里漏了会启动报错。本地推理只在桌面端可用进 Settings → Local Models一键装 sd.cpp8GB 内存能跑 SD 1.5 级别模型Z-Image 系列建议 16GBREADME 明确警告 8GB 机器可能卡死。Wan2GP 是远程引擎在一台 CUDA/ROCm GPU 机器上自己跑 Python 服务应用里填上 URL 就能把视频模型推理丢过去。 核心能力拆解从文字到 AI 视频成片用文本描述生成 AI 竖版短视频Video Studio 内置 40 多个文生视频模型Kling、Sora、Veo、Wan、Seedance 2.0、Hailuo、Runway 等。输入提示词选画幅9:16、16:9 等和时长5/10/15 秒随模型而定直接出片。做短视频素材时这条路径用得多一句话描述出几个候选挑最好的。把静图变成动态镜头上传一张图后工作室会自动切到图生视频模式60 多个模型可选Seedance 2.0 I2V 最多还能带 9 张参考图。这条路适合先用图像模型定好画面再加动的玩法构图和人物比纯文生视频可控得多。AI 视频生成结果示例同一提示词换不同模型出候选再挑一条让肖像图对着配音开口说话唇形同步工作室有 9 个模型、两种模式肖像图 音频生成说话视频已有视频 音频重做口型。前者最高支持 1080pLTX 2.3 / LTX 2 19B Lipsync后者适合给成品视频换语言配音。生成记录单独存刷新页面后未完成任务会接着轮询不会丢。用真实相机参数模拟电影镜头Cinema Studio 把虚拟相机参数翻译成提示词修饰6 种机身16mm 胶片、70mm、全画幅数码等、11 种镜头、8mm 到 85mm 焦段、f/1.4 到 f/11 光圈。选 16mm 胶片加 f/1.4 浅景深出的静帧质感就接近电影剧照拿来做项目基调参考正合适。Cinema Studio 的 16mm 胶片机身预设复古胶片色调适合做画面基调参考把图像、视频、音频模型串成流水线Workflow Studio 是节点式可视化编辑器拖模型、连线前一步的输出接给下一步。带模板库也能浏览社区工作流用 Playground 交互式跑。每个工作流都可以通过 API 调用想嵌进自己的产品可以直接对接。多工作室集成界面14 个 studio 共用同一模型目录工作流可跨模型串联API 怎么调底层调用是统一的两步式POST/api/v1/{模型端点}提交任务然后 GET/api/v1/predictions/{request_id}/result轮询到 completed 为止鉴权用x-api-key头。要把生成能力嵌进自己的应用参考 muapi.js 这个客户端就行POST /api/v1/{model-endpoint} // 提交提示词和参数 GET /api/v1/predictions/{id}/result // 轮询直到状态 completed文件上传走 multipart 接口拿到托管 URL 后传给图像条件类模型多图模型的 14 张图放在同一个请求里发。实战场景短视频素材批量试片。场景账号每天要出多条素材风格要统一。做法用文生视频固定一段提示词模板换 2、3 个模型各出一版 9:16 竖屏 5 秒视频。效果半小时拿到几版候选挑一条用不满意的改提示词重跑成本几乎只有 API 额度。视频本地化换配音。场景一条成片要改成另一种语言配音。做法唇形同步切到视频模式传原视频加新语言的音频选 LatentSync 或 Infinite Talk V2V。效果口型按新音频重新对齐不用重拍也不用整条重剪。电影概念快速可视化。场景导演要跟团队对齐画面基调口头说不清。做法Cinema Studio 里选胶片机身加浅景深同一场景换 2、3 种镜头各出一张静帧。效果团队对着具体画面讨论像不像要的那种感觉比口头描述直接得多。技术要点技术栈Next.js App Router React Tailwind CSS 做 Web 端Electron 做桌面壳Vite 构建npm workspaces 单仓库。模型来源全部模型定义集中在 models.js 一个文件里2 万多行、400 多个模型Web 端和桌面端共用加模型只改这一处。本地推理两个引擎sd.cppMetal/CUDA/Vulkan/ROCm纯 CPU 也能跑负责图像模型Wan2GP 连远程 GPU 服务器跑视频模型。硬件下限8GB 内存能跑 SD 1.5 级模型Z-Image 系列建议 16GB本地视频推理性能取决于 GPU 服务器配置。部署源码走npm run setup再electron:dev生产npm run build npm run start桌面安装包输出在release/目录。入口结构Next.js 端很薄StandaloneShell.js 负责页签导航和 API key 管理具体 studio 组件都在packages/studio/src/components/下。整体代码量不大想改界面或加模型的入手点都很清楚翻一遍入口文件就有数。开始之前这个项目把用很多 AI 视频模型从开一堆订阅网站变成一个本地工作室。最快的验证方式先用在线版把流程跑通再克隆下来npm run setup本地跑起来动手前值得把模型定义文件翻一遍知道自己要生成的东西里面有没有现成模型可用。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考