Open Generative AI 入门指南:本地部署 AI 图像生成与 AI 视频生成,5 分钟出第一张图

发布时间:2026/9/4 13:09:05
Open Generative AI 入门指南:本地部署 AI 图像生成与 AI 视频生成,5 分钟出第一张图 Open Generative AI 入门指南本地部署 AI 图像生成与 AI 视频生成5 分钟出第一张图【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AIOpen Generative AI 是一款开源的 AI 图像生成与 AI 视频生成平台内置 200 多个模型Flux、Midjourney、Kling、Sora、Veo 等MIT 协议、免费、无内容过滤、可完全自托管个人创作者和想定制功能的开发者都能直接上手。它到底能帮你创造什么打开 app/studio/ 你会看到按场景划分的工作室四条主线覆盖大多数 AI 绘画和 AI 视频需求图像工作室从文字生成图片70 文生图模型或上传参考图做修改70 图生图模型。上传参考图后可用模型集合会自动切换成编辑类模型。视频工作室文字直接生成视频或把一张静帧动画化85 文生视频、120 图生视频模型支持 5/10/15 秒时长和多种宽高比。口型同步工作室上传人物肖像加一段音频就能得到说话视频已有视频也可以重新对口型共 9 个模型覆盖两种输入方式。电影工作室面向写实的电影级镜头提供相机、镜头、焦距、光圈等专业控制适合拍剧照。除主线外还有音频、智能剪辑、营销素材、Agent 等工作室模型定义集中在 packages/studio/src/想确认某个模型是否支持某项能力查这里最准。最短路径拿到你的第一张作品部署方式挑一条然后动手生成。挑一条路。想零安装直接体验用托管的在线版浏览器打开即可用全部工作室功能与最新版本保持同步想要离线能力和本地推理装桌面应用——macOS 装 DMG拖进应用程序文件夹即可Windows 跑 EXE 安装程序Linux 用 AppImage 或 DEB 包需要改代码或贡献功能再从源码构建git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup # 安装依赖并构建 packages 下的 studio / workflow / agents 工作区 npm run dev # 启动 Next.js 开发服务器访问 http://localhost:3000仓库需 Node.js 18npm run setup不能省只跑npm install起不来。动手生成。打开图像工作室在提示词框里写一句具体描述选好模型点生成出图后从历史里下载即可。桌面应用还多一层本地推理设置 → 本地模型里可装 sd.cpp 引擎内置跑 SD 1.5 / SDXL / Z-Image 图像模型支持 CPU、Metal、CUDA、Vulkan、ROCm也可指向自己搭的 Wan2GP 服务器跑视频模型图像工作室里打开 ⚡ Local 开关后生成全程不依赖云端 API模型权重和作品都留在本机。决定画面质量的三个关键同一套模型下出片差异主要来自三个变量提示词怎么写、模型选哪个、参数怎么调。 写什么提示词的结构化表达提示词决定 AI 能不能看懂你要什么推荐按主体 动作 环境 风格 光线/材质细节组织不要只写一只猫而是一只橘色虎斑猫在阳光下的花园里睡觉毛发有光泽油画风格。不想要的元素用负面提示排除出图不理想就基于结果迭代措辞通常两三轮就能明显收敛。️ 用什么模型要配任务类型任务建议模型说明文生图Flux、Nano Banana 2通用出图Nano Banana 2 支持 1K/2K/4K 分辨率图生图Nano Banana 2 Edit支持最多 14 张参考图文生视频Kling、Seedance 2.0时长 5/10/15 秒质量基础/高档口型同步Infinite Talk肖像 音频生成说话视频一个容易踩的坑文生图和图生图是两套模型集合提供参考图后工作室会自动切到图生图集合如果画面没按预期变化先确认当前模式。️ 调什么参数按模型能力来可选项包括分辨率512×512 到 4K、质量档基础 / 高质量、宽高比1:1、16:9、9:16 等、生成步数越高细节越多、耗时越长。界面上的参数面板是智能控件只展示当前模型真正支持的项出现哪些就调哪些即可。从一张图到一段成片多图参考输入。兼容的编辑模型Nano Banana 2 Edit、Flux Kontext Dev、GPT-4o Edit 等一次最多接受 14 张参考图上传器会带序号勾选保证送入模型的顺序。适合保持角色/风格一致地换场景这类需求。上传过的素材会自动进入本地上传历史跨会话直接复用不用重复传。电影级镜头控制。Cinema Studio 源码 里的虚拟相机把专业摄影参数翻译成提示词修饰可选项包括相机70mm 胶片、8K 数码、S35 影棚机等 6 种、镜头经典变形宽幅、暖调电影定焦、旋焦人像等 11 种、焦距8mm 超广角、35mm 人眼、50mm 人像、85mm 特写、光圈f/1.4 浅景深、f/4 均衡、f/11 深焦再叠加胶片质感出图就带摄影师调过机的味道。工作流自动化。工作流工作室 用节点式编辑器把图像、视频、音频模型串成自动化流水线典型链路是生成概念图 → 提升分辨率 → 叠加艺术风格 → 批量导出。模板、社区共享流程、交互式 Playground 都内置同一条工作流也能通过 API 直接调用。遇到这些情况怎么办macOS 首次启动被 Gatekeeper 拦截现象打开 DMG 安装的应用时提示已损坏或无法验证开发者。原因应用没有经过 Apple 公证属正常拦截。解决终端执行xattr -cr /Applications/Open Generative AI.app再右键应用选打开确认一次即可也可以走 系统设置 → 隐私与安全性 → 仍要打开。Windows 弹出 SmartScreen 警告现象运行 EXE 安装程序时提示Windows 已保护你的电脑。原因安装程序未做代码签名。解决点更多信息再选仍要运行应用会静默装到本地并生成开始菜单快捷方式。Linux AppImage 无法运行现象双击无反应或提示没有执行权限。原因AppImage 需要执行权限。解决chmod x加上权限后运行。另注意 Ubuntu 24.04 默认开启的 AppArmor 用户命名空间限制会让 AppImage 静默退出推荐直接装 DEB 包自带 AppArmor 配置或临时用sudo sysctl -w kernel.apparmor_restrict_unprivileged_userns0处理。出图质量差现象画面模糊、细节糊成一团。原因分辨率或质量档给低了或提示词太笼统。解决把分辨率往高调支持 4K 的模型直接选高档换具体、结构化的提示词必要时换更擅长的模型。生成速度慢现象等出图的时间明显变长。原因网络链路或云端排队也可能是本机硬件不适合本地推理。解决先检查网络桌面应用可切换到本地模型推理本地跑模型时注意硬件门槛如 Z-Image 系列建议 16 GB 内存8 GB 内存的机器建议用轻量 SD 1.5 模型。模型选错类型现象上传了参考图画面却完全没参考它。原因文生图与图生图是两套模型当前选的还是文生图模型。解决确认上传后工作室已切换到图生图集合重新在 i2i 模型里选择。作品保存与分享现象生成完不知道东西去哪了。原因/机制所有生成记录默认保存在本地历史浏览器存储素材复用走上传历史。解决从历史面板可回看任意一次生成并一键下载全分辨率原图再导入其他编辑器或社交平台继续处理。接下来可以往哪走熟悉基本操作后有四个自然的延伸方向通过 app/api/ 下的接口把生成能力嵌入自己的应用提交 轮询的两段式调用工作流同样支持 API 执行在 packages/studio/src/ 的模型清单里添加自己的模型扩展系统能力用节点编辑器沉淀可复用的工作流或者直接参与开源开发给仓库提功能。docs/ 目录里有演示素材和示例可以先翻一遍。从一句提示词开始跑通一次完整生成剩下的能力都是在这条路径上加细节。第一张图离你大概只有五分钟。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考