AI如何在44分钟内破解370年前的密码
Claude Fable 5.1 在不到一小时内破解了困扰人类密码学家数代人的17世纪密码——Cyphral Distich。这一突破揭示了人工智能辅助历史研究的新可能。
困扰三百七十年的谜题,四十四分钟迎刃而解
Claude Fable 5.1刚刚完成了一项三百多年来无人做到的壮举:该模型破译了"赛普拉二韵诗"(Cyphral Distich)——这是苏格兰作家托马斯·厄克哈特爵士一本奇诡著作末尾附加的一组三十二行数字。该密码自1899年在《笔记与问答》杂志上作为谜题提出以来,便作为一道未解之谜流传至今。在消耗约176,000个token、历时44分钟之后,Fable 5.1得出了一条读起来如同政治宣传般的结果:
吾神保佑国王查理二世,使其成为这片土地的最高统治者。
这是一份保皇派的陈情,热烈拥护斯图亚特王朝复辟。厄克哈特素以坚定的保皇派著称,因此破译结果与历史记载完全吻合。但这一内容的真正价值远不及达成这一结果的过程本身。
模型如何抵达终点
“赛普拉二韵诗"紧跟在一组32条"普罗基里塔申”(Proquiritations)列表之后——共32条条目,每条都以句子形式呈现为一项祝愿或诉求。这一结构细节正是Fable 5.1捕捉到的第一个线索。数字32在周围文本中无处不在:32条普罗基里塔申、两行各含恰好32个数字。厄克哈特本人也特意强调了这一数字。模型将其视为信号,而非巧合。
第二个线索来自附在密码之后的诗歌,其中告诉读者:一个诚实的人会发现自己心中所渴望之物与作者的思想均隐藏其中。这暗示谜题的答案并非来自外部——不是某本遗失的密码本或失落的文献——而是内嵌于书籍本身。
基于这两条观察,Fable 5.1推导出了解码规则:对于密码中的第i个数字n,找到第i条普罗基里塔申,取其第n个单词的首字母。将这一规则应用于两行数字之后,信息便跃然浮现。整个过程耗时约44分钟的运算和处理176,000个token。尽管数十年来屡有人尝试,却从未有任何人类研究者成功发表过破译结果。
更长的密码亦告沦陷
厄克哈特在另一部名为《宝珠》(The Jewel)的书中还留下了一大段更为庞大的密码——“赛普拉八韵诗”(Cyphral Octastich)。它包含285个数字,而非32个,同样被认为是无法破解的。Fable 5.1一并处理了这道难题,还原出了几乎完整的文本——仅缺九个字母,其内容是一段为保住王室血脉而作的长篇祈祷:
至高之主,庇佑以查理二世为王首的王室家族,并赐他执掌至高权柄之力,统御英格兰、苏格兰与爱尔兰的子民,并以[·········]取代篡夺之权威,使其在先王之位上统治;愿他成为我们唯一的凯撒、亚瑟、赫克托,我们的皇帝、国王、君主与守护神。阿们,愿此成真。
中间那段残缺固然引人注意,但并不影响整体结构。破译后的文本与厄克哈特已知的政治立场和文学风格完全一致。
这到底说明了什么
这项工作的研究者Gebi Jaff将此次突破形容为并非专业密码分析能力的展示,而是一种坚持的 exercise。即便在无明显模式可寻时,模型仍持续搜索潜在规则。正是这种执着——而非蛮力的计算性能——构成了决定性差异。
Jaff同时也提醒人们勿过度外推。他指出,CIA总部内那类真正的硬密码——如Kryptos的K4片段——目前对AI模型而言仍是遥不可及的。赛普拉二韵诗之所以可解,是因为它运作于一套已知的文本体系之内——厄克哈特自己的书籍即为密钥。更难破解的密码则故意将密文与任何可及的语境割裂开来。
尽管如此,这一结果意义重大。它证明前沿模型能够执行更接近真正创造性推理的任务,而非狭隘的模式匹配。模型从稀疏线索中推断出结构,生成可验证的假设,并以历史证据加以校验。这是一种与检索或分类截然不同的问题解决范式。
谁赢谁输
早期现代英国史学家赢了。几个世纪以来一直作为奇珍异宝束之高阁的档案材料,如今可以借助一套系统性地生成假设的工具来重新审视。研究人员不再需要依赖个别耐心破译者的孤立智慧。模型能够在数小时内扫描结构模式、提出候选规则,并在可用文本中逐一验证,而非耗费数年之功。
密码学界失去的远没有你想象的那么多——这些从来不是什么高度机密的编码。厄克哈特的密码是文学噱头,而非国家机密。真正发生变化的是谁有能力接触它们。业余研究者、小型机构和无力负担昂贵计算基础设施的学者,如今都可以挑战那些过去需要个人长期投入才能攻克的难题。
AI开发者赢得了叙事主动权。破解一道370年的未解之谜,是一个极易传播的成果。作为通用能力的证据,它或许略嫌不足——任务范围相当狭窄,解答又高度依赖于模型可直接访问的文本语境——但它毫无疑问令人印象深刻。
接下来会发生什么
直接的推论是,更多尚未破译的历史文本将面临同样的待遇。内含密码的手稿、带有数字编码的页边批注、曾经抵御住前人尝试的档案谜题——所有这些都将进入候选名单。赛普拉二韵诗只是一个数据点,但它确立了一个先例。
同样值得关注的还有其局限所在。模型之所以成功,是因为答案就藏在它所能阅读的文本之中。那些精心设计以抵抗此类破解的密码——密钥需要外部知识、实物证据或刻意隐匿——不会轻易屈服。Kryptos的类比再恰当不过。人类破译者已在它的第四段上苦战数十年而无果,目前没有任何迹象表明AI会改变这一局面。
真正改变的门槛在于准入门槛。那些过去因缺乏时间或专业知识而无法涉足密码谜题的研究者,如今可以借助AI协助入场。这种民主化将对我们的历史阅读方式产生深远影响。一篇曾被判定不可解读的文字,可能其实清晰可读——只要你懂得往何处寻找,并有足够的耐心持续寻找下去。