中文譯本 · 原作 Daniel Bourdeau《Unsolved Historical Ciphers》 以 CC BY 4.0 釋出,本頁由 JIC 翻譯,非原作者官方版本,譯文如有出入以英文原頁為準 · 檢視英文原頁 ↗
Δ % ɣ % ≈ ⋈ X ♀
♡ Υ ≡ ∅ χ ♪ δ
……分為四段,約1,200個字形

紐約州埃塞克斯縣監獄 · 自創字形,可能是法語音節文字 · 1882–1883年

Debosnys 密碼

Henry Deletnack Debosnys,1882年8月在紐約州 Essex 謀殺妻子 Elizabeth Wells 而被定罪,1883年4月在 Elizabethtown 被處絞刑。他在獄中留下了詩歌、畫作,以及四段用自創文字寫成的文字。在 Klaus Schmeh 的 Top 50 中排第3位。原件藏於 Brewster Memorial Library, Essex County Historical Society。

Daniel Bourdeau · 釋出於 · 更新於

方法:未破解 · 程度:未獲得文字

沒有復原出金鑰;現存文字太短,無法做唯密文求解

2026年9月,本專案轉錄了四段中的三段,共969個字形。那首密碼詩是二十行押韻對句,其行長和韻腳都指向一種法語音節文字:一個字形對應一個口語音節。符號這麼多的音節文字,大約需要800到2,000個字形,才能使只有一個金鑰與文字相符,而現存語料總共約1,200個。所有可以作為猜詞(crib)檢驗的已知明文都失敗了,沒有復原出金鑰。從未有人發表過解讀;Sektu 2017年對其結構的分析是此前的主要工作。剩下的工作需要本專案之外的資料:Debosnys 所抄寫的原文,或他遺稿中的一張金鑰紙。

01 此前已知的情況

比通常的概述所說的要多。2017年,Sektu 部落格的作者 Brian 轉錄了全部語料(1,188個字形,425種),用一套小語法把字形分解為子字形,並提出它們是法語音節,波浪號表示鼻化。這份轉錄從未公開。本專案追蹤表的早期版本曾把字形的系統性構成當作新發現提出;其實那是 Sektu 的發現,在此歸功於他。

另有兩條線索是公開的。Matthew Brown 在2021年表明,Debosnys 留下的明文“詩”幾乎都是抄來的,大多抄自 Thomas Moore,這暗示加密的文字也可能是抄本。Nick Pelling 在2015年注意到,第9段中有明寫的首字母 H. D. D. L. M. F.,每個字母下的圓點計數了省略的字母:Henry、Deletnack、Debosnys,然後是三個分別為7、7、6個字母的詞。

02 已確定的事實

密碼詩 偶然機率低於10−5

“monographe verse”是二十行押韻對句

Debosnys 密碼詩的前四行:第一、二行以同一個橫臥的捲曲結尾,第三、四行以同一個帶點的 X 結尾
monographe verse 第1–4行(區域性)。第1、2行以同一個捲曲結尾,第3、4行以同一個帶點的 X 結尾。圖片:Brewster Memorial Library, Essex County Historical Society, Debosnys papers, the monographe verse。

每行的最後一個字形成對重複。在10組對句中的9組裡完全相同,第十對的基本形相同,只是十字的位置不同。跨對句邊界(第2和第3行、第4和第5行,依此類推)則9處中無一相同。即使任意兩個字形有五分之一的機會相同,十中有九純屬偶然的機率也只有大約百萬分之四。這正是法語對句詩平直的 AABB 韻式,而且第一組對句的韻在第九組中再次出現,正如一個讀音會重現那樣。

單位 兩條獨立的論證

一個字形對應一個法語音節

如果相同的末尾字形承載韻腳,那麼字形代表的是讀音。至於是多大的讀音單位,可以透過把這首詩與279個單位的真實詩歌樣本比較來確定:

單位每行279箇中的種類數最常見
Debosnys 字形13.91119.0%
法語音節13.51663.8%
英語音節10.21724.5%
法語單詞8.61744.7%
法語字母37.42614.7%

只有音節符合行長,而韻腳決定了語言。在真實的押韻對句中,法語詩的末音節有61%拼寫完全相同,而 Moore 的英語詩只有31%。如果是英語音節,十個結尾中有九個相同的機率約為萬分之三。所以明文最有可能是法語,儘管已知 Debosnys 抄寫的東西幾乎全是英語。

這段文字的表現像語言:重複的字形對出現的頻率是同一批字形隨機打亂後的兩倍。有兩個細節不符合單純的音節文字。帶點的 X 出現頻率高達9%,作為單個音節過於頻繁;而且它五次成對出現,或許是一個分成兩部分的符號。

語料 同一體系

三段文字,同一種文字

根據掃描件逐個字形轉錄:二十行的詩(279個字形)、第10頁上的四行密碼(99個)和散文段落第9段(597個),共969個字形,333種。這幾段共用同一套字形庫(詩中111種字形裡有47種在第9段中重現,覆蓋詩的58%),帶點的 X 在兩者中都居首位,分別佔9.0%和8.2%。薄弱之處在於同一性判定:兩個相似的複合字形是否為同一個符號。轉錄檔案記錄了每一項判定,最難辨認的一行位於一塊水漬之下。

03 已排除的可能

這裡的每一次搜尋都先在一段植入的文字(用同樣方式編碼並加入噪聲的真實法語)上執行,以證明如果確有匹配,搜尋能找到它。真實的搜尋沒有一次找到匹配。

同一頁上的詩 已排除

第10頁的四行密碼並不是對寫在其下方那首法語詩的編碼

這是最顯而易見的猜詞:約93個字形位於一首明文詩之上,而那首詩前八行約有93個音節,兩者都以問號結尾。把字形與音節對齊,並按每個字形對映的一致程度打分,真實的配對得58分,與隨機的法語詩相同(中位數59)。同一首詩的植入編碼得86到88分,而對照的最高分為80。這幾行更可能是第9段的結尾。

法語詩 已排除

在7,821個法語詩對句視窗中無一匹配

二十八卷作品(拉辛、高乃依、莫里哀、伏爾泰、布瓦洛、謝尼埃、雨果、繆塞、戈蒂耶、波德萊爾、魏爾倫)被切成所有押韻對句的20行視窗,與這首詩逐行對齊。用一個真實視窗植入的編碼以很大優勢在7,821箇中排第一;而這首詩的最佳匹配構成一條平滑的尾部,沒有離群值。Delille 翻譯的《埃涅阿斯紀》詩體譯本也是如此——之所以測它,是因為詩下方抄有維吉爾的詩句。

他抄過的東西 已排除

不是 Moore,不是 Stoddart,也不是他自己的英語抄本

將行長分佈和對句結構與 Moore 的全部詩作、Lalla Rookh、Stoddart 以及 Debosnys 本人的明文詩比較:在七千個視窗中,最佳契合度都處於偶然水平,而且 Moore 的對句詩行要短三四個音節。

字母而非音節 已排除

字形不是字母的堆疊

把每個字形的組成筆畫按某種順序視為字母並搜尋金鑰,無論法語還是英語,真實字形順序的得分都不比同一批字形隨機打亂後更好。

04 為何止步於此

唯密文攻擊需要足夠的文字來確定金鑰。對替換密碼而言,這個閾值是唯一解距離:金鑰的資訊量除以語言中每個符號的冗餘度。在二元模型下,法語詩的音節每個攜帶7.7位元;一個對應333種字形、取自600到9,000個音節庫的金鑰,攜帶3,100到4,400位元。算出的閾值約為800到2,000個字形,這還是在模型和轉錄都完美的前提下。現存語料總共約1,200個。

實驗結果與此一致。把真實的法語詩編碼成乾淨的音節文字,每個音節一個字形,不加噪聲,再用一個在115萬個音節上訓練的音節語言模型攻擊:

字形數字形種類復原的文字猜最常見的音節
1,0003640.0%3.2%
5,0009445.4%3.3%
20,0001,8104.3%2.9%

在 Debosnys 文字的長度下,求解器什麼也復原不出來。更強的求解器在長得多的文字上會做得更好,但沒有哪個能突破資訊極限。如果 Debosnys 寫的是音節文字——正如韻腳所示——那麼只有猜詞能復原金鑰。

05 什麼可能帶來解答

轉錄、指令碼和對照: targets/debosnys/ 在專案倉庫中—— verse_transcription.py, n9_transcription.py, n10_transcription.py, unitstats.py, isomorph.py, versesearch.py, syllsolve.py,完整記錄見 NOTES.md.