Open Generative AI:开源AI创作工作室,200+模型、零审查,把AI创作的门槛降到"打开网页就能用"

工具推荐 1784255817更新

1

最近有朋友跟我吐槽,说现在AI绘画和视频生成工具太多了,每个都要订阅,而且动不动就提示"内容违规"不给生成。更烦的是,图片用一个工具,视频用另一个,做唇形同步还得再换一个,账号切来切去,钱没少花,效率反而更低。

然后我就想到了一个项目,叫Open Generative AI

这个项目在GitHub上的定位是一个免费的、开源的AI视频平台替代品。MIT开源协议,代码随便改,数据留在本地。它背后接入了200多个模型,从文字生成图片、图片编辑、文字生成视频、图片生成视频,到让静态照片开口说话,全都在一个界面里搞定。

那这个项目能解决什么问题?我觉得核心就三个。

第一个,创作自由。现在市面上几乎所有AI创作工具都有自己的内容审查机制,你输入一个提示词,可能被系统判定为"不合适"就直接拦截了。这个项目则表示"No content filters, no prompt rejections, no guardrails"(无内容过滤、无提示词拒绝、无安全护栏),你的创意是什么,它就生成什么,不会有人替你做判断。

第二个,工具整合。你不需要在好几个工具之间反复横跳了,图片、视频、唇形同步、工作流编排,都在一个地方。

第三个,数据隐私。你可以选择用云端API,也可以完全离线运行,数据和模型都在你自己的电脑上。

先说说怎么用。三种方式,从简单到复杂。

网页版,最省事。打开 muapi.ai/open-generative-ai,注册免费账号就能用,功能最完整,永远最新版。

桌面应用,Electron程序,macOS、Windows、Linux都支持,去GitHub Release页面下载安装就行。桌面版独有的优势是后面会说的本地模型推理,但智能体和工作流部分功能会因为依赖网页路由而提示"网页版可用"。

源码部署,Clone下来 npm run setupnpm run dev,MIT协议随便改。

接下来,我重点说说桌面应用的使用体验。

打开应用之后,首先会弹出一个API Key输入框,去muapi.ai注册获取Key之后粘贴进去,就进入主界面了。界面顶部有一排选项卡,分别是:图像、视频、唇语同步、电影工作室、工作流、智能体、MCP & CLI。右上角可以看到账户余额,还有一个齿轮图标可以打开设置面板。

图像工作室

这个选项卡做的是图片生成,但它根据你有没有上传参考图,会自动切换模式。你什么都没上传的时候,默认是文字生成图片模式,提示词框在上面,下面有50多个模型可以选,Flux、Nano Banana 2、Seedream 5.0、Ideogram等,全是市面上主流的。你选不同的模型,界面上的选项会自动变化,比如选了Nano Banana 2,会出现分辨率选择(1K、2K、4K)和质量控制,选了其他模型这些选项又会自动隐藏。

你上传了一张参考图之后,界面会自动切到图片编辑模式,模型列表变成55个以上的编辑模型——Nano Banana 2 Edit、Flux Kontext系列、Seededit等等。Nano Banana 2 Edit支持同时上传最多14张参考图片,你选了多图模式之后,上传界面会变成多选,每张图片标注上传顺序,有一个计数器显示当前选了几张、还能选几张。上传过的图片会被存到本地历史上,下次可以直接从历史记录里选,不用重新上传。

视频工作室

逻辑和图片工作室一样。不传图片就是文字生成视频,40多个模型,包括Kling、Sora、Veo、Wan、Seedance 2.0、Hailuo、Runway。上传一张起始帧就切到图片生成视频,60多个模型。你可以选时长(5秒、10秒、15秒),选画质(basic / high),选画面比例(16:9、9:16、4:3、3:4)。

其中,Seedance 2.0模型的"Extend"功能很有意思,如果你生成了5秒的视频觉得不够长,不需要重新生成,直接无缝延长,可选5秒、10秒或15秒,保持风格、动作和音频的一致性,延长的时候还能输入新的提示词让后续内容往不同方向发展。

唇语同步工作室

这个选项卡有两种模式,通过一个切换按钮来选。人像模式,你上传一张人物照片和一段音频,AI生成这个人"说话"的视频,支持Infinite Talk、Wan 2.2 Speech to Video、LTX 2.3 Lipsync、LTX 2 19B Lipsync四个模型,分辨率从480p到1080p。视频模式,你上传一段已有视频和一段音频,AI自动把视频里人物的口型跟音频对齐,支持Sync、LatentSync、Creatify、Veed、Infinite Talk V2V五个模型。生成历史是单独保存的,页面刷新了任务也不会丢。

电影工作室

这个选项卡模拟了真实电影摄影机的参数控制。界面上有四个下拉选项:摄影机类型(全画幅数字电影机、70mm胶片机、经典16mm胶片机、模块化8K数字机等)、镜头(变形宽银幕、微距、复古、70年代电影镜头、暖色调电影镜头等十几种)、焦距(从8mm超广角到85mm人像特写)、光圈(f/1.4浅景深、f/4均衡、f/11深景深)。每个选项旁边有对应的预览图,你选了之后,这些参数会自动转换成优化的提示词,附加到你的输入里,帮助生成更有电影感的画面。

工作流工作室

这个选项卡打开之后是一个可视化的节点编辑器,你可以把多个AI操作串联成一个自动化流程。左侧是模板库和社区分享的工作流,中间是画布区域,可以拖拽节点来连接不同的模型。比如你先用文字生成一张图片,然后自动把这张图片送去视频模型做成动画,最后再送去唇形同步模型配上声音——整个过程一键完成。做好的工作流可以保存到"我的工作流",也可以发布到社区。每个工作流还能通过API调用,方便集成到自己的应用中。和智能体一样,工作流在桌面应用中也会提示网页版可用,完整功能建议在网页版上体验。

智能体

这个选项卡在桌面应用中会提示网页版可用(open-generative-ai.com),因为智能体功能依赖于完整的网页应用路由。在网页版上,打开智能体选项卡,你会看到一个智能体模板市场,分为三个子页面:Templates(模板市场),里面是官方和社区分享的各种智能体角色,点击就能直接对话;My Agents(我的智能体),你自己创建和管理的智能体;My Chats(我的对话),之前聊过的历史记录。你可以点击任意模板开始对话,也可以自己创建新智能体,自定义它的名字、角色设定和绑定的模型。

MCP & CLI

这个选项卡是给开发者准备的。它展示了三个工具:muapi-cli,一个命令行工具,可以在终端里直接生成图片和视频,支持JSON输出方便脚本调用;muapi-mcp-server,一个MCP服务,可以让Claude、Cursor、Windsurf这些AI编程助手直接调用100多个模型;Generative Media Skills,一套技能包,为Claude Code等工具提供了电影导演、Logo设计、YouTube Shorts等预设流程。界面上有安装命令和示例代码,可以直接复制使用。

接下来重点说一下设置面板里的本地模型功能,这是桌面应用独有的,网页版用不了。

点击右上角的齿轮图标打开设置面板,默认显示的是API Key的管理页面,旁边还有一个"本地模型"选项卡,点进去之后分成两个区域。

上面是sd.cpp推理引擎的状态。第一次打开会显示"未安装",旁边有一个安装按钮,点击之后会自动下载引擎文件,有进度条显示下载进度。安装完成之后状态会变成绿色,显示"已安装"。

引擎装好之后,下面会出现模型列表。默认有Dreamshaper 8、Realistic Vision v5.1、Anything v5、SDXL Base 1.0、Z-Image Turbo、Z-Image Base这几个模型可选。每个模型卡片上标注了类型(SD 1.5、SDXL、扩散Transformer)、文件大小(2.1GB到6.9GB不等),还有一个下载按钮。你需要哪个模型就点下载,同样有进度条。

这里有个需要注意的地方:Z-Image系列模型(Turbo和Base)需要额外下载两个辅助文件Qwen3-4B Text Encoder(2.4GB)和FLUX VAE(335MB)。这两个文件下载一次就行,两个Z-Image模型共享。如果你用的是8GB内存的Mac,Z-Image模型可能会让系统卡死,建议用SD 1.5系列的模型,对配置要求低很多。

在Mac M系列芯片上,Metal GPU加速会自动启用,跑一张SD 1.5的图大概每步1到2秒。如果发现速度异常慢(每步10秒以上),可能是GPU加速没生效,可以重新安装引擎试试。

模型下载好之后,回到图像工作室,在模型选择器旁边会多出一个"本地"开关。打开这个开关,模型列表就切换为本地已下载的模型,选一个就能离线生成,完全不需要API Key。

到现在,你可能会有个疑问:那MuAPI的API Key是什么?要不要花钱?

这里需要说清楚,这个项目本身确实完全免费,MIT开源协议,代码你想怎么用就怎么用。

但如果通过云端API调用模型,模型本身的计算资源是MuAPI提供的,这部分是按使用量收费的,不是订阅制,是按次计费,用多少付多少。注册MuAPI免费账号后即可开始使用,具体的免费额度可以在MuAPI后台查看(https://muapi.ai/pricing)。

如果你觉得云端API的费用吃不消,本地模型是完全免费的,一文钱都不用花。下载sd.cpp引擎和模型文件之后,你在图像工作室里把"本地"开关打开,就可以离线生成,不需要API Key,也不产生任何费用。本地模型目前主要支持图片生成,视频模型虽然Wan2GP在技术上支持,但视频工作室的本地界面集成还在开发中,暂时还是得走云端。

回过头来看,我最初推荐这个项目给朋友,其实还有一个考虑。

现在AI工具虽然越来越强,但入门门槛并不低。不同工具分散在不同的平台,注册不同的账号,适应不同的界面逻辑,更别说那些需要配Python环境的本地工具了。

但Open Generative AI把这件事简化到了一个程度:打开网页就能用,下载安装包就能本地跑,200多个模型的选择被做成了自动切换的下拉菜单。对于一个想快速上手AI创作的人来说,这种"开箱即用"的体验,可能比有没有最新模型更重要。

项目地址:https://github.com/Anil-matcha/Open-Generative-AI