ARTICLE DETAIL

资讯详情

深耕网站建设、视觉设计与SEO优化的一线实战洞察。

Open Generative AI 如何完成本地 AI 视频生成:400+ 模型无内容限制完整指南

Open Generative AI 如何完成本地 AI 视频生成:400+ 模型无内容限制完整指南 Open Generative AI 如何完成本地 AI 视频生成400 模型无内容限制完整指南【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AIOpen Generative AI 是一个开源自托管的 AI 图像与视频生成工作室面向内容创作者、影视制作人和想自建生成工具的开发者。它内置 14 个工作室、420 多个模型Flux、Midjourney、Kling、Sora、Veo 等无内容限制MIT 许可支持网页、桌面应用与 Docker 自托管三种形态也支持本地 AI 视频生成。它解决了什么问题闭源 AI 视频平台把生成能力锁在订阅里月费从十美元到百美元不等提示词会被过滤或改写生成数据留在厂商云端模型选择也受平台限制。Open Generative AI 的做法是把整套工具链开源给你自己无内容过滤提示词不会被拒绝或改写无订阅费MIT 许可可自由修改和分发可自托管数据留在自己的机器上420 多个模型自由切换不再被单一平台绑死本地推理引擎可离线出图连 API key 都可以不用。差异一句话同样的生成能力它把控制权从平台交还给你。最快上手路径按上手速度排序三条路径任选其一。用网页版三步开始生成最快的路径是零安装的网页版不需要 Node.js不需要本地环境打开官方在线版注册账号把 Muapi 的 API key 填进设置。之后所有工作室直接在浏览器里使用云端模型随开随用但本地推理只在桌面端提供。安装桌面预构建包大多数用户推荐预构建的桌面应用无需终端一键安装macOSApple Silicon 和 Intel 各有一个 DMG。应用未经 Apple 公证首次启动会被 Gatekeeper 拦截——终端执行一次xattr -cr /Applications/Open Generative AI.app再右键选择打开即可Windowsx64 安装包。若出现 SmartScreen 警告点「更多信息」再选「仍要运行」Linux提供 AppImage 与 .deb 两种包Ubuntu 24.04 及以上系统建议装 .deb它自带 AppArmor 配置可免去用户命名空间限制。从源码或 Docker 自托管部署这条路径面向贡献者和开发者需要 Node.js 18 以上git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup注意--recurse-submodules不能省工作流和 Agent 功能来自子模块仓库npm run setup会装依赖并构建全部工作区包之后npm run dev起 Web 版、npm run electron:dev起桌面版。想直接自托管用 Dockerfile 配 docker-compose.yml 一条命令起服务默认映射到 3001 端口。它能帮你做什么按你实际要完成的创作任务来说。从一句话生成可用图片输入场景描述从 50 多个文生图模型里选一个Nano Banana 2、Seedream 5.0、Ideogram、GPT-4o 等选定比例和分辨率后点生成。上传参考图后会自动切到 55 多个图生图模型集合兼容的编辑模型最多接收 14 张参考图按你勾选的顺序送入模型。桌面端还能切换到本地模型出图不消耗任何云端额度。把文字变成镜头在动的视频输入一句描述从 40 多个文生视频模型Kling、Sora、Veo、Seedance 2.0、Hailuo 等中挑一个按模型能力选 5/10/15 秒时长和宽高比产出即可发布的短视频。想动一张静图上传首帧后系统切到 60 多个图生视频模型首帧就是画面起点。让照片对口型说出声音上传一张肖像图加一段音频选 9 个唇形同步模型之一Infinite Talk、LTX Lipsync 等产出人物嘴型与音频对齐的说话视频。已有视频也能用视频 音频进重新对口的视频出适合配音和多语言本地化。用相机参数拍出电影镜头在电影工作室里选相机6 种机身从 70mm 胶片到模块化 8K 数字、镜头12 种从 70 年代定焦到变形宽银幕、焦距8mm 超宽到 85mm 特写和光圈f/1.4 到 f/11。这些选择会被翻译成优化过的提示词修饰符产出具有真实镜头质感的画面。适合谁用短视频创作者同一句描述跑不同模型快速出多个版本几分钟内挑出能发的那条影视和广告团队用电影工作室低成本做概念镜头和风格预览替代昂贵的实机试拍数据敏感的团队和个人Docker 自托管加本地推理素材和成品全程不出自己的机器。上手技巧提示词写清镜头、光线、景别和材质可以得到更贴近预期的画面上传一张风格参考图可以得到角色与色调统一的连续内容用多参考图模型一次传入多张图并保持顺序可以得到更强的画面一致性在图像工作室切到本地模型可以得到不消耗云端额度的出图结果先降分辨率和时长跑通流程可以得到更快的验证反馈确认后再调回高画质。给开发者的信息云端调用是「提交 轮询」两步POST 提示词到模型端点拿到 request_id再循环查询结果直到状态为 completed认证用 x-api-key 请求头。客户端实现在 src/lib/muapi.js 与 packages/studio/src/muapi.js。本地推理有两套引擎都在 设置 → 本地模型 里配置sd.cpp 引擎随桌面端捆绑支持 Apple Silicon 的 Metal、CUDA、Vulkan、ROCm 与纯 CPU覆盖 SD 1.5、SDXL 与 Z-Image 等图像模型视频模型走 Wan2GP需要你在有 CUDA 或 ROCm GPU 的机器上自跑服务器再把地址填进桌面端。Z-Image 类大模型建议 16GB 内存以上8GB 的 Mac 跑 SD 1.5 更稳妥。扩展入口很集中所有模型定义在 packages/studio/src/models.js 一个文件里改它一处自托管版和网页版同时生效工作流、Agent 与设计 Agent 分别是 packages/ 下的独立包可直接拷进自己的项目复用。常见问题Q1桌面应用第一次打开被系统拦截原因是应用未做平台签名公证。macOS 用 xattr 命令解除标记或走「系统设置 → 隐私与安全性 → 仍要打开」一次即可Windows 在 SmartScreen 里选「仍要运行」。Q2填了 API key 还是提示无效要确认填的是 key 的值而不是名称或标签key 只存在浏览器本地仅发往 Muapi 网关。只用本地模型推理时可以完全不填 key。Q3生成质量不如预期先检查提示词是否给了镜头、光线、景别这类具体信息其次换参考图最后再考虑换模型——不同模型擅长的风格差异很大质量差通常不是单点问题。Q4本地推理特别慢先确认没有回落到纯 CPU再降分辨率、减步数只有 Mac 的话把 Wan2GP 服务器跑在局域网的 GPU 机器上把推理卸载出去。Q5能商用吗应用本身是 MIT 许可允许商业使用、修改与分发但集成进来的第三方模型可能有各自的使用条款商用前逐个核对。项目本质是给你一台自建的 AI 影像工作室无过滤、420 模型、数据留在自己手里MIT 许可保证后续扩展不受约束。三种部署形态按需求选形态门槛适合网页版零安装快速出效果、团队协作桌面应用一键安装包本地推理、离线创作Docker 自托管需要容器环境内网部署、持续自托管只想先看效果就从网页版开始想让素材不出机器就装桌面包要给团队长期用就走 Docker。仓库地址在上面快速上手一节设置里填好 API key你的第一次生成就可以开始了。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表