反AI字体无用且有害
本文批评反AI字体试图通过混淆文本来阻止AI抓取,认为这既损害可访问性,又无法真正阻止AI,最终可能助长网络审查和付费墙。
反AI字体无用且有害制作“反AI”字体来混淆或扰乱文本是徒劳的。对于扰乱文本的字体来说,这是一个可访问性问题,因为屏幕阅读器和其他辅助工具解析的正是被扰乱的文本。这样一来,你已经切断了与许多你想要触达的人类用户的联系。
如果你不知道我指的是什么,这里有几个例子:编辑:我想先澄清一下,我并非针对这些具体例子,也不是要否定创作它们或其他反AI字体所付出的努力。这篇文章旨在批判这个想法本身,而不是贬低任何人!因为可访问的解决方案需要机器可读的元数据,所以根本无法以可访问的方式实现这一点。
这让我们回到了人类验证这一巨大问题,以及与之相关的所有隐私和安全问题。最终,试图解决选择性向残障人士授予元数据访问权限的问题,将导致通过某种集中式身份验证系统来过滤内容。除非你是纳粹或某种反社会者,否则我认为创建大量残障人士名单不是我们想走的路。
关于这一主题的公开帖子和讨论已经在指导AI公司如何训练其多模态模型来绕过这些混淆,其中大部分已经被破解。
我认为每一个新字体和技术演示实际上都是一个基准测试,挑战AI公司想出解决方案来绕过它们。而它们终将以某种方式被绕过。如果人类能看到信息,就意味着信息有办法被解析。“幽灵”字体将成为又一个带有自身应急措施的抓取障碍。
我见过的一些涉及动态图形和视频的更复杂的演示,对于网站的正常使用来说并不实用,因此作为这个问题的严肃长期解决方案并不重要。此外,如果一种有效的混淆方法以某种方式得到广泛使用,那么破解它的优先级就会大大提高,最终使其失效。
如果这种猫鼠游戏导致所有网站都高度混淆,需要计算成本高昂的系统来合法或非法访问内容,那就毫无意义。最终结果可能是某种版权保护系统,这将有利于那些想要审查网络、设置付费墙和其他守门方法来阻止内容访问的人。
我们最好保持网络现状,完全用纯文本编写。此外,混淆违背了万维网的创立精神:为了人类的利益,自由开放地获取信息。我认为这个问题永远不会有灵丹妙药。
虽然AI系统能力提升的速度备受争议,但AI系统永远不会变得更笨。不管你喜欢与否,所有公开可用的信息都将不可避免地变得可被任何有权访问的人或事物获取。这是人们需要围绕规划的基线场景。