Spirula Studio 是一款真正“开箱即用”的3D高斯泼溅(3D Gaussian Splatting, 3DGS)训练与重建工具——它把原本需要 Python 环境、PyTorch、CUDA 工具链、COLMAP 摄影测量、OpenCV 预处理、MeshLab 后处理等一整套繁琐流程,压缩进一个独立可执行文件中。无论你手头是 iPhone 拍的360°视频、运动相机录的鱼眼素材,还是无人机航拍片段,只需拖入软件,点击“训练”,几分钟内就能获得带纹理的3D高斯模型、深度图、法线贴图,甚至可导出的三角网格(mesh)和天空盒。它不依赖任何外部运行时,也不强制绑定 NVIDIA 显卡——AMD、Intel 核显、Apple M 系列芯片全原生支持。
核心功能
- 跨厂商显卡统一训练引擎:告别“只认NVIDIA”的限制。基于 Vulkan Compute 实现,一套代码同时支持 NVIDIA(Windows/Linux)、AMD Radeon(Linux/Windows)、Intel Arc(Linux)、Apple M1/M2/M3(macOS),无需切换后端或重编译——对高校实验室(多品牌GPU共存)、MacBook用户、开源硬件爱好者尤为友好。
- 360°与鱼眼镜头“零预处理”直训:传统3DGS流程需先用 equirectangular-undistort 或 custom calibration 工具对全景/鱼眼图像做畸变校正,再喂给 COLMAP;Spirula Studio 内置原生球面坐标建模能力,直接加载 .mp4/.mov(含GoPro/Insta360元数据)或 .equirectangular 图像序列,自动解析投影模型并参与SfM重建,省去至少3步手动操作和潜在精度损失。
- 8GB显存跑满1000万SH3高斯点:通过量化训练(quantized training)+ 内存池复用 + Vulkan 绑定表优化,在仅8GB VRAM的设备(如RTX 4060、Radeon RX 7600、M2 Pro)上稳定训练完整球谐阶数(SH3)的高斯参数,输出质量媲美16GB+显存方案,大幅降低个人创作者和学生党入门门槛。
- 内置闪电级SfM+AI智能掩码:无需等待COLMAP耗时数小时的特征匹配与稀疏重建——Spirula 自研轻量SfM模块集成 LoMa(鲁棒特征匹配算法),在弱纹理、动态模糊、低光照场景下仍能收敛;同时内置实时AI前景分割(支持人/车/建筑等常见类别),自动剔除移动物体干扰,避免“漂浮高斯”(floaters)和背景坍缩,提升重建几何完整性。
- 端到端输出:从高斯点云到可交付3D资产:训练完成后,一键生成:① 可交互Web查看器(支持HDR、PBR材质预览);② 带顶点色/UV映射的OBJ/GLTF网格模型;③ 法线/深度/遮罩/天空盒贴图;④ 支持时间轴编辑的3DGS动画导出(.mp4/.webm);⑤ 指定视角批量渲染图集——真正打通“采集→重建→编辑→交付”全链路。
- 真实尺度还原与多语言界面:利用视频/图像EXIF中的GPS、陀螺仪、IMU等遥测元数据(telemetry metadata),自动恢复毫米级真实尺寸与世界坐标系朝向,解决行业长期痛点——“为什么重建出来的小汽车比真车大三倍?”;GUI与CLI全面支持简体中文、繁体中文、日语、韩语等13种语言,中文用户首次启动即享母语体验。
技术亮点

- 纯C++ Vulkan原生架构:全栈自研,无Python胶水层、无PyTorch张量调度开销。计算核心(高斯梯度更新、辐射场采样、光栅化融合)全部通过SPIR-V编译为Vulkan Compute Shader,在GPU上零拷贝执行;相比PyTorch+torch-ngp类方案,内存带宽占用降低40%,VRAM峰值下降25%。
- 融合MCMC/IGS+/MRNF的混合优化策略:非简单复刻论文公式,而是将马尔可夫链蒙特卡洛(MCMC)的全局探索性、IGS+的局部密度自适应分裂、MRNF的渐进式密度控制三者耦合设计,实现“物体边界锐利、大场景结构稳定、小物体不丢失”的平衡效果,实测在Garage、Mip-NeRF 360等标准数据集上PSNR平均提升2.1dB。
- 双曝光校正引擎:Bilateral Grid + PPISP:针对手机/运动相机拍摄中常见的过曝高光与白平衡偏移,采用双边网格(Bilateral Grid)进行空间自适应亮度映射,叠加PPISP(Physics-based Photo Illumination and Spectral Processing)模型校正色温与光谱响应,全程保持线性色彩空间,杜绝传统LUT调色导致的暗部死黑或肤色失真。
- 单二进制全功能封装:Windows/Linux/macOS 三大平台发布包均为静态链接的单文件(~120MB),包含Vulkan运行时、FFmpeg解码器、ONNX Runtime推理引擎、Web服务器(用于训练可视化),用户解压即用,彻底规避“缺dll”“找不到libvulkan.so”“CUDA版本冲突”等经典部署噩梦。
适合哪些人用
✅ 三维内容创作者:独立游戏开发者用iPhone 15 Pro录制客厅全景视频,15分钟生成带PBR材质的Unity可导入GLTF模型;电商摄影师为家具产品制作360°展示页,跳过建模师环节,直接输出网页级3D查看器链接。
✅ 高校科研与教学团队:计算机视觉课程实验中,学生用笔记本核显(Intel Arc A380)完成3DGS全流程实践;机器人实验室利用DJI无人机视频+IMU数据,重建校园地图并获取精确尺度的点云用于SLAM验证。
快速上手
下载对应系统Release包(https://github.com/harry7557558/spirula-studio/releases/),解压后:
• Windows:双击 spirula-gui.exe → 拖入视频/图片文件夹 → 点击「Train」
• macOS:终端执行 xattr -d com.apple.quarantine spirula-gui 解除隔离 → 双击运行
• Linux(需Vulkan驱动):终端运行 ./spirula-gui
命令行进阶:训练时自动开启Web服务,SSH远程训练可加 -b 0.0.0.0:8080 并端口转发,浏览器访问 http://localhost:8080 实时查看3D渲染流与损失曲线。
同类对比 / 注意事项
- vs gaussian-splatting(官方PyTorch版):后者需完整CUDA环境+PyTorch 2.0+,仅支持NVIDIA;Spirula 在M2 Max上训练速度达其85%,但显存占用仅1/3,且自带SfM无需COLMAP。
- vs Instant-NGP / NerfStudio:NeRF类方法需数小时训练且无法导出显式网格;Spirula 输出高斯点云可直接编辑(支持删除/移动/着色),并一键转OBJ/GLTF,更适合工业交付。
- 注意事项:GPL-3.0协议要求衍生作品开源;Vulkan后端在部分老旧Intel核显(HD Graphics 620及更早)上可能需手动启用VK_ICD_FILENAMES;首次训练建议用「Low VRAM」模式(GUI中可选)验证数据兼容性。
项目信息
Cross-vendor 3D Gaussian Splatting trainer – video to splat to mesh, Vulkan or CUDA.
814
今日 +69 stars today
Stars
57
Forks
C++
GPL-3.0
C++ 编写|GitHub Star 数:814|开源协议:GPL-3.0|GitHub 项目地址
如果你厌倦了配置环境、等待COLMAP、纠结显卡型号——Spirula Studio 就是那个让你今天下午就能把手机拍的街景变成可旋转、可导出、带真实尺寸的3D模型的终极生产力工具。






