开发者 Eric Lu 发布的一个名为「Ghost Font(幽灵字体)」的实验,7 月中旬在网上迅速走红,视频一夜播放超过 1700 万。它的特别之处在于:人眼能一眼读出其中的文字,而 AI 逐帧去看,却只看到一片雪花般的噪点。但热度过后仅一天,这道”只有人能读”的壁垒,就被一句提示词攻破。
已知事实
- 它是什么:Ghost Font 不是普通字体,而是一种用动态噪点视频承载文字的排版实验。构成字母的像素统一向上滑动,背景噪点统一向下滑动;人脑靠”共同命运”(common fate)这一格式塔运动知觉原理,一眼就能把向上运动的那部分识别成文字,而 AI 若逐帧看静止画面,看到的只是无意义的噪点。
- 走红:视频发布后一夜播放超过 1700 万次。
- AI 最初”翻车”:据报道,Claude Fable 与 GPT-5.6 Sol Ultra 起初都失败了——两个模型都”自信地”给出了答案,但读出的是作者故意埋进去的诱饵文本,并非真正隐藏的信息。
- 一句提示被破解:提示工程师 Riley Goodside 只给了 GPT-5.6 Sol 一句方向提示——”构成字母的噪点像素向上滑动,其余像素向下滑动”。得到这一个方向提示后,Sol 用约 1 分 56 秒读出了正确答案:”RILEY WAS HERE”。
- 事件弧:约 7 月 11 日发布 → 7 月 12 日爆火 → 7 月 13 日被破解,前后约 72 小时,完整记录了这场”人类先胜、AI 反杀”的攻防。
横向与纵向定位
横向看,Ghost Font 属于近来一类”用运动/时间维度对抗静态识别”的视觉实验。多数针对 AI 的”抗识别”手法是在单帧图像上做文章(加噪、扭曲、对抗样本),而它把信息编码进”运动方向”——利用人类运动知觉是连续、整体的,而多模态模型默认逐帧、静态地理解画面这一差异。它揭示的不是”AI 读不懂字”,而是”AI 默认不往运动这个方向想”:一旦被提示该看运动,模型很快就能补上这一课。
纵向看,这件事把”人类感知相对 AI 的独特优势到底有多稳固”这个问题,摆到了很具体的位置。它先给出一个直觉上令人振奋的结论——有些东西人一眼能懂、AI 却抓瞎;又在一天内给出冷静的反转——所谓壁垒,可能只差模型”一个没被提示到的思路”。这条线的意义在于:人相对 AI 的优势,越来越少来自”某种 AI 永远做不到的感知”,越来越多来自”知道该往哪个方向想、该问什么问题”。Ghost Font 的攻防,正是这种优势形态转变的一个鲜活注脚。
⚠️ 待核实:发布与破解的具体时间、1700 万播放量、”1 分 56 秒”等数字以创作者与一手报道为准;”Claude Fable / GPT-5.6 Sol Ultra 均失败”及破解过程为报道口径,具体表现随提示与版本而异;隐藏文本、诱饵文本的具体内容以作者公布为准。
Ghost Font 用”运动方向编码文字”制造了一个人眼可读、AI 逐帧却只见噪点的实验,一夜爆火后仅一天即被一句方向提示破解,说明 AI 的短板往往不在”感知能力”而在”默认思路”;对设计与视觉创作而言,它既是一个关于人机感知差异的生动案例,也提示:人相对 AI 的优势正从”某种独有感知”转向”知道该往哪想、该问什么”,其具体细节仍需以创作者与一手信源为准。
参考来源:
- 创作者 Eric Lu(X / 项目页):https://ghostfont.org/
- 36Kr(英文·事件复盘):https://eu.36kr.com/en/p/3893751713708553
- Tom’s Guide(实测):https://www.tomsguide.com/ai/someone-created-a-ghost-font-that-humans-can-read-but-ai-cant-i-had-to-try-it-for-myself
- Hacker News(讨论):https://news.ycombinator.com/item?id=48870381