你是否遇到过这样的困扰:用Claude Code写完一份技术文档,粘贴到博客时发现文字莫名错乱、换行异常,甚至复制后出现看不见的乱码?或者导出PDF报告后被同事指出“图片里藏着AI生成痕迹”,却找不到源头?watermark-remover 就是为此而生——它不是简单涂抹图片Logo,而是专为开发者和内容创作者设计的「AI水印深度净化工具」,能精准识别并清除嵌入在文本字符、图像元数据、办公文档甚至音视频文件中的多厂商AI隐形水印与溯源标记。
核心功能
- 清除Unicode隐形水印:自动检测并删除Claude、Gemini等模型注入的不可见Unicode字符(如零宽空格、双向控制符、标签字符),解决复制粘贴后格式错乱、代码无法执行、SEO文本污染等问题。
- 破解统计型文本水印:针对OpenAI、Kirchenbauer绿名单、Aaronson EXP等基于token采样分布的隐蔽水印,提供可配置强度的语义重写(paraphrase/rewrite),在保留原意前提下打乱统计指纹。
- 剥离C2PA可信媒体认证:彻底移除JPEG/PNG/WebP/HEIC等图像中由Adobe、Microsoft、Intel等厂商嵌入的C2PA标准数字水印(含AI生成声明、时间戳、模型签名),让原创图片回归“干净本体”。
- 清理全格式文档元数据:支持PDF、DOCX、XLSX、PPTX、EPUB、ODT、HTML、Markdown等15+格式,批量擦除EXIF、XMP、文档属性(Author/Producer/Creator)、自定义XML命名空间等泄露AI生成线索的隐藏字段。
- 自动化文件写入钩子(Hook):集成Claude Code/Cursor/Grok等AI编程环境,启用后可在每次保存文件时自动触发检查或清理(支持check/clean双模式),无需手动调用,真正实现“无感净化”。
- 纯Python服务化架构:核心逻辑完全基于Python 3.10+标准库实现,不依赖PyTorch/TensorFlow等重型框架;技能端(Skill)仅为轻量HTTP客户端,适配Claude插件、Cursor技能、Grok扩展等多种宿主环境。
- 按层分级处理策略:明确划分Layer A(字符级)、Layer B(统计级)、Files(文件级)三层净化能力,用户可按需启用,避免过度处理影响内容质量。
- 离线本地运行保障隐私:所有敏感内容(含源码、文档、设计稿)均在本地完成分析与清洗,不上传任何数据至云端,满足企业合规与个人隐私强需求场景。
技术亮点
- “技能+服务”解耦架构:不同于传统单体工具,它将AI代理端(Skill)与实际处理端(Service)分离——Claude或Cursor只需安装一个几KB的技能包,所有繁重解析、重写、元数据操作均由本地Python服务(默认监听
http://127.0.0.1:8765)完成,极大降低客户端资源占用与兼容门槛。 - 跨厂商水印覆盖矩阵:README明确列出支持Claude、Gemini/SynthID-Text、OpenAI Provenance、Kirchenbauer绿名单、keyed-Gumbel、Aaronson EXP等主流方案,并通过分层表格(A/B/Files)清晰界定每类水印的检测原理与清除方式,非黑盒式“暴力删”,而是有据可依的精准治理。
- 零依赖核心+渐进式增强:基础功能仅需Python 3.10+ stdlib;当系统存在
c2patool(C2PA官方工具)、exiftool、qpdf时,自动启用更深层解析能力(如PDF对象流分析、C2PA二进制签名校验),兼顾简洁性与专业性。 - Hook机制直击工作流痛点:创新引入
PostToolUse钩子,监听Write/Edit/MultiEdit等编辑动作,在文件落盘瞬间完成扫描或清洗,并通过通知机制反馈结果,将防护从“事后补救”升级为“事中拦截”,真正融入AI编码日常。
适合哪些人用
这款工具特别适合三类人群:AI原生开发者(在Claude Code/Cursor中高频使用AI生成代码、文档、注释,需确保输出纯净无痕)、数字内容创作者(运营技术博客、制作教学视频、发布设计稿,拒绝被平台标记为“AI生成”而限流)、企业合规工程师(审核对外交付物是否含敏感AI元数据,满足GDPR/《生成式AI服务管理暂行办法》等监管要求)。
真实场景举例:一位前端工程师用Claude Code生成React组件文档,直接导出为MD后发现标题前多了几个看不见的U+2069字符,导致GitHub Pages渲染异常——运行clean_text.py即可秒级修复;某出版社编辑将AI润色后的PDF书稿提交印刷前,用clean_file.py一键剥离C2PA与XMP中的“Generated by Gemini”声明,规避版权争议。
快速上手
只需三步,5分钟内启用:
- 安装技能:在Claude Code终端运行
python3 install_skill.py --skill remove-ai-marks --target claude-code - 启动服务:项目根目录执行
make serve(或python3 service/scripts/server.py --host 127.0.0.1 --port 8765) - 启用钩子(推荐):进入Claude Code设置 → Plugin Settings → 找到watermarks-remover → 将
Hook mode设为clean,此后每次保存文件即自动净化。
命令行快速验证:python3 service/scripts/clean_file.py report.pdf -o report.clean.pdfpython3 service/scripts/clean_text.py notes.md --stats(添加–stats查看水印检测详情)
同类对比 / 注意事项
- vs 通用元数据擦除工具(如exiftool -all=):watermark-remover不止于EXIF,深度支持C2PA结构化解析、Unicode隐写识别、统计水印重写,且专为AI内容优化,不会误删版权信息等合法元数据。
- vs 在线AI水印检测网站:完全离线运行,无隐私泄露风险;支持批量、脚本化、Hook自动化,而非单次网页上传,更适合工程化落地。
- 注意事项:当前
rewrite_text.py默认仅打印重写提示(--backend print-prompt),如需实际执行需指定--backend llm并配置API密钥;DOCX/PDF等二进制文件的文本层清洗需先提取正文,建议配合inspect_file.py预检再操作。
项目信息
ShadowAqueduct/watermark-remover
GitHub
Purge multi-vendor AI watermarks: clean Unicode text, apply statistical rewrite hooks, and clear C2PA plus metadata from PNG, JPEG, SVG, PDF, DOCX, HT
761
Stars
73
Forks
Python
MIT
编程语言:Python|Star 数:761|开源协议:MIT|GitHub 项目地址
如果你厌倦了AI生成内容被隐形水印绑架,又不愿牺牲效率与隐私——这可能是目前中文世界最务实、最透明、最易集成的AI水印治理方案。


