ARTICLE · 1114642
AI揭秘“217年未解拿破仑密信”
1809年,正是法兰西第一帝国如日中天的时候。在战场上运筹帷幄的拿破仑·波拿巴,给他的爱将,马尔蒙元帅发去了一封前线军事密信。
为了防止被反法同盟截获,这封信采用了极其烧脑的“同音替代密码”。信中不仅有大量的干扰符号,同一个字母还用好几种不同的奇怪图形来代替。
时过境迁,由于破解密码的原始密钥早就丢失了,如今没有人知道当年的这封信件里说了什么。
于是217年的尘封,让无数历史学家和密码学家抓耳挠腮不得其解。之后这份信被收录在历史密码研究项目Cryptianna的档案中,归类为“未破解”的加密文本。

但就在前几天,一位名叫Carter Church,就职于一家美国网络安全公司的AI工程师,利用OpenAI的GPT-6 Astra模型破解了这份密信。前后大概花了6个小时,也就一顿下午茶加晚饭的功夫,一个几百年的小迷题解决了。

我们先来说一下拿破仑的这份密信为什么困扰了人们很久而难以破解。
这份密信使用了“同音替代密码”也叫“多名替代密码”。这是一个15世纪就开始使用的文字加密手段,被外交密信广泛使用。
一般普通的替换密码就是明文和密文字母一一对应,但最大的弱点是哪些频繁出现的字母,例如字母e,很容易被人猜出来,从而破译。而“同音替代密码”给高频率出现的明文字母分配了多个密文符号,加密时随机选用一个,这样破译者就无法通过重复的密文字母找到破绽。

著名的美国黄道十二宫杀手邮寄给报社的第一份信件中的密码就属于同音替代密码。不过一周内就被民间密码学热爱者破解了。

而拿破仑的这份信的困难之处在于:
首先,这份信是手写的,同一个符号在不同的位置可能写得略有差异,但问题就随之而来了,这种差异是故意的呢,还是手写习惯造成?如果是故意的,那么可能同一个字符的不同写法就代表着不同的明文,而如果是书写习惯造成的,那么就只代表一个明文。所以这种情况特别容易让破译出错。

另外,对于密码破译来说,肯定是样本越大越好。而拿破仑的这份信全文大约只有1300个加密符号,却包含了155种不同的书写形式,混用了数字、拉丁字母、希腊字母以及各种自创记号。所以,在这种样本量少,里面变化却很多的文本中,规律性的特征就相对比较难以抓到。
先前有位来自法国的密码学史学家Daniel Tant专门研究了这套拿破仑时期的密码系统,不过只破译出了33个符号,这样,大概能读出信件大约三分之一的内容。
而Carter Church使用的GPT-6 Astra正是以这33个破译出的符号作为起点,在最近正式出圈破解了拿破仑的全篇信件内容。
在整套破解过程中,Ai先是读取了信件的扫描图片,区分手写笔记变体;然后自动构建了模拟退火求解器,用来给除了已破解的33个符号外的剩余符号找到可以对应的明文。
所谓模拟退火求解器是一种全局优化搜索算法,用来在海量候选的组合里找到最优的明文与密文对应关系,非常适合同音替代这类密码破解。
要知道Carter Church并不是一个专业密码学家,而是AI工程师,所以破译都是靠AI实现的。但他设计了一套端到端的全套破译流程,项目中除了密码破解外,还包括了图像识别、历史考据、翻译与结果校验。Carter已经公开了这套破译方案,附带密钥、密文转录稿,还有可以复现解密结果的脚本。
那么拿破仑的这份密信究竟写了什么呢?
这份信并不是拿破仑亲笔写的,而是他的继子欧仁按照拿破仑的指令,发给马尔蒙元帅的密信。1809年正是奥法战争期间,第五次反法同盟战争,奥地利在英国出资的支持下,向法国宣战。

信中用大量篇幅详细列出了拿破仑一方在战争前夕的兵力分布与人数。拿破仑在信中说“奥地利将同时遭遇到四面八方的攻击,从而迅速走向灭亡”,指示马尔蒙准备行军,并叮嘱不要被奥地利的几只小部队或一群乌合之众吓倒。

不得不承认AI的厉害,几百年的历史面纱就这么轻轻给揭开了,似乎不费吹灰之力。而拿破仑这份密信也只是AI揭秘的冰山一角。
最近一年不断有AI将历史上的密文破译出来的报道。例如今年上半年,一份来自梵蒂冈档案馆、400多年未被破解的手稿,AI用了29分钟就解开了部分内容,发现了其中隐藏的古老医疗配方;还有最近,一份二战期间德军发出的电报,也被GPT-6破解了。
这些成功的案例都体现了AI破译密码的独特优势,它能够发现人眼忽略的微弱模式,并且以远超人类的速度测试大量的假设答案,从而不断的靠近真相。最关键是,原本破解需要耗费大量的时间,但在AI的协助下,时间大大缩减。由此我们也可以断定,后面AI可能还会解开更多的密文谜题,填补上历史记录中点点空白,让我们一睹历史真容。
本文系微信公众号【即刻新知】内容。感谢您关注我们,如欲转载,请先留言。