ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Open Generative AI:把提示词变成影视级视频与图像的开源生成工作室

Open Generative AI:把提示词变成影视级视频与图像的开源生成工作室 Open Generative AI把提示词变成影视级视频与图像的开源生成工作室【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AIOpen Generative AI 是一个可自托管的开源 AI 视频生成与图像创作平台内置 400 余个模型覆盖文生图、图生图、文生视频、图生视频和唇形同步MIT 协议无内容过滤器没有订阅费用。它解决的是什么问题商业 AI 视频平台按月收费提示词会被过滤或改写模型由平台单方面决定你能用什么。而自部署一个模型又得自己搭训练和推理环境门槛高且模型更新慢。它用一个模型目录 统一 API 网关的方式解决这个问题所有模型定义集中在 packages/studio/src/models.js 一个文件里维护图像、视频、音频、工作流 14 个工作室共用同一套模型池和界面你只负责写提示词。相比闭源订阅制平台它把选择权和源码都交还给你——Midjourney、Runway 这类平台体验依旧流畅只是不开放模型目录和二次开发。核心功能拆解写提示词出图传参考图就自动切换编辑模式图像工作室不让你手动选模式不传参考图时下拉框列出 70 多个文生图模型Flux、Midjourney、Seedream 等一旦上传参考图模型集合自动换成 55 多个图生图模型提示词从必填变为可选。做海报迭代、给同一主体换背景时这个自动切换省掉一次来回选择。一句话出视频也可以让首帧动起来视频工作室沿用同样的双模式设计纯文本提示词走 40 多个文生视频模型Kling、Sora、Veo、Wan 等上传首帧图后切换到 60 多个图生视频模型。核心实现在 src/components/VideoStudio.js。需要一段有具体运动逻辑的镜头、或者把已有设计稿动起来时用得上。让静止人像开口说话唇形同步工作室支持 9 个专用模型、两种输入人像照片 音频生成说话视频或现有视频 音频替换口型。做配音、多语言版本、数字人口播时它是主力入口生成历史单独保存刷新页面后未完成的任务会自动续跑。像调摄影机一样调镜头参数电影工作室把相机型号、镜头、焦距、光圈做成了可视选项比如 70mm 胶片机配 f/1.4 浅景深、85mm 人像焦段这些选择会被翻译成优化后的提示词修饰符。想要胶片感电影感但又说不清具体参数时直接点预设即可。拖节点串起多模型流水线工作流工作室提供节点式可视化编辑器把图像、视频、音频模型连成多步流水线输出直接路由给下一个节点还能浏览社区模板并在 Playground 里交互式运行。当你需要图生图 → 图生视频 → 加配音这种固定组合反复执行时把它存成模板最划算。从 0 到跑通最短上手路径入口适合谁操作步骤桌面应用Electron想要本地推理的用户从 Releases 下载对应平台安装包macOS .dmg / Windows .exe / Linux AppImage 或 .deb打开后进入设置页填入 MuAPI 密钥即可开始生成Web 版Next.js只想先试试的用户npm run setup装依赖并构建工作区包npm run dev启动浏览器打开 http://localhost:3000本地推理仅桌面端不想用云 API 的用户设置 → Local Models 里一键安装 sd.cpp 引擎并下载模型之后在图像工作室点 ⚡ Local 开关无需任何密钥macOS 首次打开若被 Gatekeeper 拦截在终端执行一次xattr -cr /Applications/Open Generative AI.app后右键打开即可。用好它的几个实战技巧你会遇到生成质量不稳定可以这样处理把场景、主体、运动方向写全并上传一张高质量参考图让模型有明确依据。你会遇到等待时间长可以这样处理视频生成本身耗时较长轮询默认最长约 2 分钟视频任务更长别反复刷新本地推理可换 LTX 这类快模型或降低分辨率。你会遇到本地推理卡死可以这样处理Z-Image 系列需要 16GB 内存8GB 的 Mac 上建议只用 SD 1.5 模型约 2GB。你会遇到提示词和模型不匹配可以这样处理电影工作室里直接选镜头预设比手写cinematic之类的泛词更可控。延伸能力集成、自动化与二次开发API 两步模式先 POST 到模型端点提交任务拿到 request_id 后轮询结果接口直到 completed完整客户端封装在 src/lib/muapi.js你可以照这个模式把生成能力接进自己的系统。工作流串联每个工作流同样可通过 API 调用批量任务不用走界面。二次开发Next.js npm workspaces 结构模型目录、工作室组件都在 packages/studio 里加模型或改界面直接改源码即可。你大概率会问Q: 不用 API 密钥能跑吗A: 可以。桌面端装 sd.cpp 引擎并下载本地模型后全程离线生成不需要任何密钥。Q: macOS 打开应用提示已损坏或无法验证开发者A: 应用未做 Apple 公证。终端执行xattr -cr /Applications/Open Generative AI.app再右键打开一次即可。Q: Linux 上 AppImage 打不开A: 旧系统装libfuse2Ubuntu 24.04 及以上受 AppArmor 限制建议直接装 .deb 包它自带相应配置。Q: 上传的参考图要每次重传吗A: 不用。所有上传过的图片保存在本地历史里生成时从选择面板直接勾选即可跨会话有效。Q: 可以商用吗A: 项目本身是 MIT 协议允许商用、修改和分发注意各接入的 AI 模型可能有自己的使用条款。它适合想绕过订阅费和内容过滤、把模型选择权握在自己手里的创作者也适合想基于现成工作室做二次开发的团队。下一步很简单✅ 400 模型、14 个工作室MIT 开源✅ 无内容过滤提示词不被拦截✅ 可自托管数据留在本机✅ 桌面端支持 sd.cpp / Wan2GP 本地推理✅ 节点式工作流可 API 调用把仓库 clone 下来git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI跑一次npm run setup大约 10 分钟就能看到第一个生成结果。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表