一段看起来干净的文本里可能藏着几十个不可见的 Unicode 字符——零宽空格、方向控制符、变体选择符,甚至用 Tag 字符编码的完整隐藏明文。本文讲清六类字符层隐写手法的原理、如何检测和清除、emoji 为什么容易被误报,以及字符扫描工具的能力边界:它检测不了 Claude 这类藏在词汇概率里的统计水印。
2026 年 8 月起,新发布的 Claude 模型会在生成的每段文本里嵌入不可见水印,图片等文件附加 C2PA 签名元数据,全球生效且无法关闭。本文基于 Anthropic 官方文档拆解水印的真实机制(不是零宽字符)、复制粘贴为什么带不掉、目前能否检测和去除,以及官方自己承认的检测边界。