一则发自 1918 年 11 月 27 日、长度仅 170 字符的德军密电,在德国科普网站全球 50 大未解密码榜单上躺了多年。科技博客 Prinzai 拿出刚发布的 GPT-6 Astra,声称直接还原出德军报告英国巡洋舰驶入塞瓦斯托波尔港的明文。
几乎在同一周,文史领域又传出新战报:同一款模型在牛顿留下的庞大炼金术手稿中,顺藤摸瓜找出一处学界数十年未定论的法文拉丁自由翻译源头。
两件事叠在一起,社交网络立刻掀起一轮狂欢。赞叹者宣称大语言模型终结了百年密码,顺道踏平了历史考据的学术门槛。但这两起案例拆解到底,模型既没有从数理层面撕开坚固的密码体制,也没有突然习得严密的史学逻辑。
这是一场长上下文模型驱动的档案暴力重配。
算法复核:这不是凭空编造的文字幻觉
面对大语言模型吐出的古旧德文长句,首要防范的是幻觉。德军战地通讯这类冷门专有文本,极易被参数概率捏造成一段看似通顺的谎言。
开源研究者在 GitHub 公布的复现脚本排除了这种可能。电文使用的是一战经典 ADFGVX 复合密码,其构造分两步:先通过 6×6 坐标网格把字母转为双字符,再按特定密钥词做单次或多次列移位。

Childs 专著《一战德国军事密码的历史与原理》第 214 至 215 页记录了一个 19 字母密钥“TRUPPENVERSCHIEBUNG”。只要严格按照这个单词的字母序对 170 个字符按列重排,逆向执行移位解密,确实能稳定掉落出一串连贯的德语文本。
底层计算分毫不差,但字符带着明显的毛刺。明文中写着 EIN ENGLISCHER KREUZER EINLIEG X SEWASTOPOL X S4STEN X,“EINLIEG”属于战地不规范拼写,日期位置更出现了污损字符“S4STEN”。
原作者和模型并没有靠纯文本猜词,而是调取了英国皇家海军坎特伯雷号巡洋舰(HMS Canterbury)在 1918 年 11 月 24 日进驻该港的航海日志,据此反推模糊数字为 24 日。
牛顿炼金术笔记的溯源同样遵循这个逻辑。面对牛顿隐晦的转写和随意变换的措辞,模型没有推导任何数理定律,而是在数十万字的多语言扫描文献中,抓住了词句频率与结构对应点,完成了人工肉眼极易漏看的一处跨语种文本对齐。
概念除魅:档案重配而非密码学攻破
把上述过程包装成 AI 攻破高难度密码,在学术界立不住脚。
密码学分析的核心,是在缺乏密钥的极度匮乏状态下,仅凭密文的统计学分布和数学缺陷逆推原文。一战末期德军在东线留下的 668 份 ADFGVX 电报中,密码学家 George Lasry 团队早已破译了 618 份。剩下十多份悬案,学界早已推断并非密码不可解,而是战乱撤退时前线抄错了发报日期,或者归档时放错了卷宗。

GPT-6 Astra 真正做成的事情,是一次大胆的跨档案排查。
在 Childs 原著里,那串 19 字母密钥明确标注为 1918 年 12 月 9 日启用。百年来人类解密者遵循严谨的时间线索,从未想过把 12 月的钥匙插进 11 月 27 日的锁眼。模型跨过了人为划定的时间界限,把同一本书里记录的邻近已知参数直接套用上去,锁芯应声而转。
从约翰·迪伊的手稿统计,到达尔文散落笔记的串联,再到 Claude Opus 5.5 遍历 5,000 份哈特利伯档案追查匿名来源,机器展现的优势始终如一:它不厌其烦,不受专业分科的思维定势限制,能在百万级长上下文里进行不知疲倦的排列组合。
这种能力极其管用,但它属于高级数字检索,绝非数理攻坚。
提示词黑盒:假说与学术定论的分界
狂欢之后,必须直面学术审查的铁律。
OpenAI 在 2026 年 9 月初端出 GPT-6 Astra,上下文窗口达 1,050,000 tokens,官方主打其在数学、编程与长线调查中的能力,甚至给出了触及严重级网络安全阈值的警告。但在官方系统卡片里,根本没有一战密码这块勋章。

关键疑点在于过程不可见。原始发文至今未公开完整的 Prompt 交互记录与代码解释器调用路径。外界无从验证:究竟是模型自主阅读全书推导出密钥错期,还是人类研究者在提示词里圈定了候选单词列表,甚至直接下达了用第 214 页密钥逐行尝试的指令。
文史考据讲求孤证不立。截至 2026 年 9 月下旬,无论是 George Lasry 等密码学学者,还是牛顿手稿项目的专业考据机构,都没有发表正式同行评议。
借助外部舰船日志推断污损字母,在逻辑上行得通,但在版本学上仍只是未受原件对勘的高概率推测。至于模型声称定位到了德国联邦档案馆的内部文档,更无法断定是模型通过接口调取了公共记录,还是其训练集吞噬了未经公开的私有库。
古人讲按图索骥,始得其半。大模型是一架马力前所未见的数字翻检机,能把散落各处的时间碎屑重新拼接成图。但若把已知钥匙的重新试错描摹成无坚不摧的算法神迹,终究是混淆了开锁与编目的界限。
