Ghost Font:人类可读但AI无法识别的反AI字体
Ghost Font是一种利用运动、噪声和诱饵消息的字体,人类能轻松阅读,但前沿AI模型难以解码,探索了AI视觉感知的极限。
Ghost Font一种反AI字体,人类可以阅读,但领先的AI模型无法识别。在下方输入文本,然后下载并分享包含你信息的视频片段。什么是Ghost Font?Ghost Font是一种利用运动来书写信息的反AI字体。
通过结合运动、视频、噪声和诱饵,它是一种与其他真实人类分享信息的独特方式。严格来说,它并非传统意义上的TTF字体文件。但Ghost Font是一种实验,旨在以AI难以理解的格式进行图形化书面交流。
虽然它不如普通文本清晰,但人眼仍能立即识别字母,而即使是领先的AI模型也难以轻易破译。用Ghost Font生成的视频被传递给Claude Fable和GPT Sol 5.6 Ultra等领先AI模型。
即使是这些具备编码能力的最新智能体,在未被告知具体查找技术之前,也难以解码移动的信息。上面的游乐场只是这个概念的原型。输入几个单词,字母就会出现,但这只是因为人眼能看到点的运动。当视频暂停时,静态的点会混在一起,仅凭单帧图像无法判断其中嵌入了什么信息。
这意味着截取页面截图不会显示信息。
此实验在本地运行——输入信息并实时预览,或下载视频分享并自行测试。数据不会共享或发送到任何服务器。关于这个项目2013年,设计师Sang Mun发布了一款名为ZXX的字体。这是一种包含四种字体的字型,设计为人类可读但光学字符识别(OCR)软件无法识别。
字母被噪声伪装、划掉并埋在虚假标记下。当时,这种字体被认为是“防监控”的——但快进到今天,现代AI智能体可以轻松读取ZXX渲染的文本。虽然这在2013年可能击败了OCR软件,但现代AI模型可以轻松读取ZXX中的文本。
我将这张图片复制到ChatGPT 5.5的即时模式中,它仍然能在单次提示中识别出文字,包括一些细节:然而,对Ghost Font进行同样的操作就不那么容易了。Ghost Font的单张截图只会产生完全静态的图像,没有可读文本。
这是因为Ghost Font中的每个字母都由看起来与背景完全相同的点组成,因此视频中的任何单帧都不会透露信息:经过19分钟的分析,ChatGPT 5.5 Pro幻觉出了一条不存在的消息。然而,简单地将信息隐藏在视频中并非完美解决方案。
虽然在线模型环境可能无法从单帧中获取信息,但拥有本地代码执行环境的专用智能体仍然可以分析点的运动并解码信息。Ghost Font通过另一种分层方式解决了这个问题:每次视频生成中都包含一条诱饵消息。
诱饵消息是对付坚定智能体的最后手段。当寻找隐藏信息时,它可能首先找到诱饵消息,并认为那是视频中真正嵌入的信息。这就是Ghost Font能够隐藏信息,甚至对Fable和GPT Sol 5.6 Ultra等最强推理模型也有效的原因。
最终,真正隐藏信息的方法是使用加密或某种密钥。没有AI能读取需要只有人类知道的特定密码才能解锁的信息。然而,这个项目探索了是否可能创建一个包含AI模型无法轻易读取的视觉信息的可共享文件。我们创建这个实验是为了探索AI感知的极限,同时保留一些人类的东西。
随着AI接管字体生成,我们希望人类能继续拥有独特的创意声音。下一步是什么?我认为Ghost Font有一些值得继续探索的含义。例如,将Ghost Font整合到CAPTCHA系统中会很有趣,因为如今大多数系统都很容易被AI破解。
在视频中使用运动将使自动机器人更难破译,但人类阅读仍然相对容易。在视觉感知方面,Ghost Font也可能是衡量AI进展的一种有趣方式。目前,多模态模型是基于图像的,即使输入视频,它们通常也会将视频拆分为帧并分析各个帧。
在不久的将来,我猜想会出现一个视频原生模型,能够直接读取文本。最后一个教训是,AI确实变得非常强大。虽然Ghost Font对AI来说很难读,但对人类来说也很难读!差距正在不断缩小。在AI感知和多模态模型方面,未来会怎样,这很有趣。
下一步,我计划将视频生成的代码作为开源项目发布——敬请期待!我还希望扩大尺寸并处理更长的文本字符串。希望你喜欢这个实验,我很想听听你的想法。你可以在X上@ericlu找到我。——Eric