OpenHiggsfield 是一款面向创作者的开源 AI 生成工具,它把原本分散在多个平台、需要反复切换界面、配置参数、管理密钥的图像与视频生成流程,浓缩进一个极简却功能完备的浏览器工作室中。它不是另一个“调用 Stable Diffusion 的网页前端”,而是真正以「模型即服务」为设计原点——每个模型自带专属参数面板、媒体输入规则和能力边界,用户只需专注创意表达,技术细节由系统自动对齐。它解决的核心问题是:为什么我们还要为一个封闭的商业 Studio 付费?为什么不能用自己的 API 密钥、在自己的设备上、用自己熟悉的逻辑,批量生成高质量内容?
核心功能
- 一栏统管图与视频生成:告别「图片页+视频页」双入口割裂体验。同一个提示词输入框(支持 Cmd/Ctrl+Enter 快捷提交),选择 Nano Banana Pro 就出图,选 Kling 3 Turbo 就出视频——模型类型决定输出形态,UI 层零冗余,大幅降低多模态创作的认知负担。
- 40 款主流模型开箱即用,且持续可扩展:涵盖 12 款图像模型(如 Flux、Ideogram、Qwen-VL、GPT-Image 2)和 28 款视频模型(Kling 全系 5 档、Veo 3.1、LTX、PixVerse、Soul Cinema 等),全部集成在统一搜索下拉菜单中;新增模型只需向
src/generation/catalog/添加配置文件,无需修改 UI 逻辑,开发者友好度极高。 - 每款模型拥有「专属参数面板」,拒绝一刀切设置:Kling 视频支持「时长、运动强度、4K 开关」,而 Flux 图像只暴露「风格强度、负向提示权重」——所有参数均由模型自身声明允许范围,UI 动态渲染,彻底规避「明明模型不支持却显示灰显选项」或「关键参数被隐藏」的行业通病。
- 角色化媒体输入 + 资产复用库:上传参考图时自动识别为「起始帧」,拖入音频则归类为「背景音轨」,系统按模型声明的「输入角色约束」(如最多 2 张参考图、仅支持 MP3 音频)实时校验;更关键的是,所有历史生成结果、本地上传素材均聚合在「资产库」中,点击即可插入到新任务对应位置,真正实现「一次生成、多次复用」。
- 智能批处理与实时运行生命周期管理:单次提交最多生成 4 张图或 4 段视频;每项任务在画廊网格中立即生成骨架占位符,后台每 4 秒轮询状态,失败/完成均独立触发动画反馈——你永远知道哪块在跑、哪块卡住、哪块已就绪,而非面对一片静默的加载转圈。
- 四维画廊 + 批量操作 + 可逆删除:按「图像/视频/全部资产/收藏夹」四标签导航;支持 Shift 多选、批量下载(含 CDN 失效检测与进度报告)、批量收藏/取消、批量删除;删除后 6 秒内可通过顶部渐隐式 Undo 条恢复,避免误操作导致重跑成本。
- 全链路密钥自主管控:你的平台 API Key(格式为
id:secret)仅通过服务端 Action 存入 HttpOnly Cookie,前端永不触碰明文;顶部状态灯实时显示「密钥是否有效」+「当前是否有任务运行中」,缺失密钥会强制弹窗引导,绝不静默失败。 - 离线可用的历史缓存:最近 60 条生成记录持久化至浏览器 IndexedDB,即使断网也能查看历史缩略图、重用参数;收藏项永久保留不滚动淘汰,确保重要资产不丢失。
技术亮点
- Next.js 16 App Router + React 19 构建现代 SSR 体验:服务端渲染保障首屏秒开,动态路由天然适配「/kling」「/flux」等模型专属路径;App Router 的 Server Components 特性让敏感操作(如密钥存储、API 请求转发)完全剥离前端,安全边界清晰。
- 「Catalog 即协议」的声明式架构:整个生成能力由
src/generation/catalog/下的 JSON Schema 驱动——每个模型定义其输入字段、媒体角色、参数枚举、默认值、提示词增强策略;UI 和服务端 Action 均基于此自动生成逻辑,实现「增一模型,全栈生效」,杜绝硬编码维护地狱。 - 纯前端媒体流调度 + Vercel Blob 无感上传:用户上传的参考图/音频经前端压缩与格式校验后,直传至 Vercel Blob 并返回公开 URL;该 URL 作为元数据随请求发往目标平台 API,全程不经过 OpenHiggsfield 自身后端,既降低部署复杂度,又规避了中间服务器带宽瓶颈与合规风险。
- Zustand + plain CSS 极简状态管理:放弃 Redux 等重型方案,用 Zustand 实现跨组件状态同步(如全局密钥状态、画廊筛选模式);样式层坚持手写 CSS(非 CSS-in-JS),体积轻、调试直观、主题定制成本低,适合二次开发团队快速上手。
- 服务端 Action 全权代理 API 调用:浏览器从不直连第三方生成 API,所有请求均由 Next.js Server Action 封装发起,自动注入 Authorization Header,并统一处理错误响应与 NSFW 标记,形成可控的安全网关,也便于未来接入审计、限流、缓存等企业级能力。
适合哪些人用
OpenHiggsfield 不是给「只想点几下出图」的新手准备的玩具,而是为三类真实用户打造的生产力杠杆:
- 独立设计师 & 小型工作室:需频繁对比 Kling Turbo 与 Veo 3.1 的运镜效果,同时为同一脚本生成多版分镜图。他们用 OpenHiggsfield 在一个页面内切换模型、复用参考帧、批量导出 PNG 序列,省去在 5 个标签页间复制粘贴的 70% 时间。
- 技术型内容创作者:运营 AI 工具测评频道,需稳定复现不同模型在相同 prompt 下的输出差异。他们利用「Reuse」功能一键还原完整参数组合,结合画廊时间戳做横向对比,甚至导出 JSON 日志用于自动化分析。
- 私有化部署需求强烈的团队:某电商公司需在内网生成商品广告图,但禁止使用外部 SaaS。他们克隆仓库,将服务端 Action 改为对接内部 SDXL 集群 + 内部 FFmpeg 视频合成服务,仅修改 catalog 配置与 Action 实现,3 小时完成定制化部署。
快速上手
无需 Node.js 环境,直接访问 https://openhiggsfield.ai 即可使用在线版。首次打开后点击右上角「🔑」图标,输入你的平台密钥(例如 Kling 的 kl_xxx:xxx),保存后即可开始生成。
若需自托管:
- 克隆项目:
git clone https://github.com/wide-trace/open-higgsfield.git - 安装依赖:
pnpm install(推荐 pnpm,项目已优化依赖树) - 配置环境变量(根目录创建
.env.local):NEXT_PUBLIC_VERCEL_BLOB_TOKEN=your_blob_tokenNEXT_PUBLIC_GENERATION_BASE_URL=https://your-api-gateway.com(若需代理请求) - 启动开发服:
pnpm dev,访问http://localhost:3000
注意:生产部署建议使用 Vercel(官方推荐),静态资源自动 CDN 加速,Blob 存储开箱即用。
同类对比 / 注意事项
相比 Higgsfield AI 官方版,OpenHiggsfield 最大差异在于「所有权转移」:它不卖订阅,不收分成,不采集训练数据,所有生成行为均发生在你授权的第三方平台,OpenHiggsfield 仅作「智能调度器」。而对比 ComfyUI 或 Draw Things 等本地工具,它胜在零硬件门槛、跨设备同步、多模型统一工作流;但需注意——它本身不提供算力,必须自行申请各平台 API Key(部分模型如 Kling、Veo 需官网申请白名单)。
常见坑提醒:① 首次使用务必检查密钥格式是否为 id:secret(非 Bearer Token);② 某些模型(如 GPT-Image 2)要求 prompt 含明确主体描述,空泛提示易失败;③ 上传大视频文件时建议先转为 MP4/H.264 编码,避免 Blob 上传超时。
项目信息
A studio for image and video generation — one prompt bar, each model’s own settings, and every finished run in one gallery.
TypeScript · Star 数:688 · 开源协议:未在 README 明确声明(建议使用前查阅 LICENSE 文件) · GitHub 项目地址
如果你厌倦了在不同 AI 平台间复制粘贴、忍受模糊的参数说明、担心账号被封导致历史作品清零——OpenHiggsfield 就是你等待已久的「创作主权回归工具」:它不生产模型,只让模型为你所用;不贩卖幻觉,只交付确定性的工作流。


