top of page

ウジェーヌ・ド・ボアルネ:また一つの歴史的暗号がAIにより解読、ただし検証は依然重要

3 日前
読了時間: 18分

GPT-6 Astraが217年前の軍事伝令を解読したと報じられたことで、ウジェーヌ・ド・ボアルネは「また一つの歴史的暗号がAIにより解読」の中心人物となった。

この文書は、ナポレオン・ボナパルトの継子でありイタリア副王でもあったウジェーヌの司令部から発せられた。1809年の対オーストリア戦争の準備に際し、ナポレオンがオーギュスト・ド・マルモン将軍へ伝えた指示を伝達する内容だった。

この点は、書き手をナポレオンの甥とする誤解を招く説明を正すものである。この書簡はナポレオン自身が書いたものでもない。ナポレオンの命令に基づき、ウジェーヌの司令部から送られた暗号化された作戦説明だった。

AIエンジニアのCarter Churchによれば、OpenAIのGPT-6 Astraは約6時間のモデル実行時間で、主要な転写と解読作業を完了した。資料は、1,300個の暗号単位で埋め尽くされた低解像度の複製画像1枚だった。

最も重要な成果は、劇的な軍事上の新事実ではない。予想される内容の多くは、ナポレオンの公刊書簡集にすでに記されていた。

真の変化は方法論にある。報告によれば、1つのモデルが画像処理から記号分類、計算機による暗号解読、歴史調査、再現可能な検証までを、一連の調査の中で進めた。

この組み合わせは、見過ごされてきたアーカイブ上の問題をAI支援学術研究の試金石へと変える。同時に、最も重要な限界も浮き彫りにする。もっともらしい読みを生成することは、その読みが正しいと立証することより容易だ。

217年を経て、また一つの歴史的暗号がAIにより解読

復元された伝令は、無名の暗号化文書を、ナポレオンが1809年3月16日に発した記録済みの命令へと結び付ける。

現存するページは、マルモン将軍宛ての判読可能なフランス語の一文で始まる。その後に続くのは、数字、通常の文字、見慣れない手書き記号から成る24行のブロックだ。

暗号化された部分は、1969年発行のフランス軍事史誌に複製されていた。1,202×1,836ピクセルのこの複製は、完全な暗号文を収めた唯一の一般公開画像とみられる。

数十年にわたり、この文書は未解決の歴史的暗号として掲載され続けた。著名なオンライン・カタログでは1807年の書簡とされ、その日付さえ誤っていた。

Churchの復元では、文書は1809年3月下旬のものと位置付けられる。この年代特定は、読める冒頭部への言及、ナポレオン書簡集、そして文中に描かれた軍事情勢に基づく。

ナポレオンは3月16日にウジェーヌへ書簡を送っていた。彼は副王に対し、フランス軍および同盟軍の主力がどこに配置されているかをマルモンへ伝えるよう命じた。

命令では、ウジェーヌは有能な将校に託した暗号書簡で情報を送るよう指示された。続いてナポレオンは、7つの部隊について、指揮官、所在地、報告上の兵力を列挙した。

解読された伝令は、同じ部隊を同じ順序で示している。ミュンヘンとパッサウの間のバイエルン軍、ヴィスワ川沿いのポーランド軍、ドレスデン近郊のザクセン軍、そしてドイツ各地のフランス軍部隊を記している。

この一致は、検証の根拠の中核を成す。解読書簡と比較できる既知の歴史文書を提供するからだ。

伝令はマルモンの立場にも合致する。彼はダルマチアのフランス軍を指揮しており、ナポレオンの主力部隊から隔てられ、オーストリアが敵対行動を始めた場合には脆弱な状況にあった。

このメッセージは、彼を安心させ、鼓舞するために設計されていた。オーストリアが複数方向からの攻撃にさらされていると説明し、移動を命じられても威圧されないようマルモンに伝えている。

復元された文言には、「少数の兵士、あるいは烏合の衆の集まり」という印象的な表現が含まれる。ナポレオンの公刊された3月16日の命令は、「ひと握りの」の後に当たる箇所で途切れている。

したがって、暗号化された伝達文は、欠落部分が何を意味していたかについての証拠を与える。ただし、ウジェーヌの司令部が命令を言い換えていたため、ナポレオンの正確な原文を確定するものではない。

この文書には、報告されたオーストリア軍の所在地や、オーストリア民兵に関する論評も加えられている。これらの詳細はナポレオンの3月16日の指示には含まれていなかった。

Churchは、詳細なsolution packageで、解読結果、技術的説明、復元した鍵、検証資料を公開している。このパッケージにより、他の研究者は提案された鍵を完全な転写と照合できる。

歴史的暗号のCryptianaカタログを管理するSatoshi Tomokiyoは、この成果をレビューした。その後カタログは、この書簡を解決済みと記し、日付を1809年へ修正した。

このレビューは結果を強化するが、広範な学術的査読と同じではない。資料は依然として不完全な複製画像1枚であり、いくつかの稀な記号には別解の余地が残る。

GPT-6 Astraはいかにしてナポレオン暗号を解いたか

GPT-6 Astraの注目すべき貢献は、新しい暗号解読技法の発明ではなく、複数の異なる作業を統合したことにある。

この暗号は、同音異字式の換字暗号である。この方式では、複数の記号が同じ頻出文字を表せるため、基本的な頻度分析の有効性が低下する。

最終的な復元では、1,300個の暗号単位と155種類の異なる記号が確認された。一部の記号は個々の文字を表し、別の記号は単語全体やその他の機能を表す。

部分的な鍵はすでに存在していた。フランス暗号学史家のDaniel Tantは、1,300単位中435単位に相当する33記号の値を公開していた。

しかし、その表がこの特定のページと確実に結び付けられていたわけではない。説明文は、ウジェーヌ・ド・ボアルネと「General Grammont」の間の暗号に言及していたようで、おそらくマルモンの誤記だった。

Churchによれば、Astraはウェブ調査の過程でこの表を見つけ、画像に照らして検証した。既知の記号は文書の十分な部分と一致し、有用な出発点となった。

モデルはまず、スキャンしたページを行ごとに分割し、視覚的に異なる記号に暫定ラベルを割り当てた。これにより、1,320個の暫定単位と175の暫定記号クラスが得られた。

この段階は、従来の光学文字認識より難しかった。手書き記号は、ページ全体で大きさ、形状、インク濃度、向きが変化していた。

システムは、2つの印が別の記号を表すのか、あるいは同じ記号の手書き上の異形にすぎないのかを判断しなければならなかった。最終転写では、これらの暫定クラスを155記号へ統合した。

続いてAstraは、Tantの表にある既知の値を固定し、通常の文字で書かれた短い可読部分を保持した。これらの手掛かりを合わせると、暗号単位のおよそ3分の1をカバーした。

残る記号については、より高いスコアの平文を探しながら候補鍵を繰り返し変更する最適化手法、焼きなまし法が用いられた。

候補となる読みは、フランス語の文字列パターンに対して評価された。スコアリング用データには、フランス語テキストから抽出した3文字、4文字、5文字のパターンが含まれていた。

これは、より広範なモデル主導プロセスに組み込まれた、従来型の計算機暗号解読だった。HistoCrypt studyでは、同音異字式換字暗号に対する焼きなまし法がすでに説明されている。

解読器は、一部の記号が個別の文字ではなく単語全体を表すことも認識する必要があった。Churchの技術的説明によれば、最終的に29記号が単語記号として分類された。

そのため、「de」「que」「vous」「général」といった語は、単一の暗号単位として現れ得る。ほかの記号は、無意味文字、句読点、または重複文字として機能した。

提案された鍵が首尾一貫したフランス語を生み出すと、モデルは原画像に現れる各記号と値を照合した。この画像ベースのレビューは重要だった。転写ミス1つが、その後の複数の推論を汚染しかねないからだ。

最終鍵は、編集上の修正なしに、1,300個すべての単位へ順番に適用できた。Churchは転写、記号台帳、鍵ファイル、提案された読みを再生成するスクリプトも公開した。

これにより、結果は機械的に検証可能になる。別の研究者は、洗練された英語訳を信頼だけに基づいて受け入れる必要がない。

ただし、「機械的に検証可能」であることは、すべての単語が確実だという意味ではない。公表された鍵が、公表された転写から一貫して公表されたフランス語を生成する、という意味である。

5つの記号には、依然として重要な曖昧さが残る。ある箇所は「陛下」または「皇帝」を指す可能性があり、別の箇所は「フリウリ軍」または「フリウリにおいて」と読める可能性がある。

これらの代替解釈は、全体の軍事的メッセージを変えない。しかし、完成されたように見える出力を、完全なテキスト上の確実性と混同すべきではない理由を示している。

突破口はワークフローの圧縮だった

この成果が重要なのは、AIが学際的なアーカイブ研究プロジェクトを、好奇心を持つ1人のエンジニアでも扱える調査へと圧縮したからである。

専門家であれば、おそらく数十年前にこの暗号を解けただろう。2026年に本質的に新しい発見があったわけではない。

スキャン画像はデジタル化された雑誌で利用できた。部分的な表は公開され、ナポレオン書簡集は19世紀以来印刷されており、マルモンの回想録にもアクセスできた。

障害は注目だった。このページを解くには、誰かが複製を見つけ、何百もの曖昧な記号を転写し、当時のフランス語を理解し、解読器を構築し、歴史的文脈を調査する必要があった。

この作業には、明白な職業上の見返りがほとんどなかった。必要な専門性を持つ研究者には、時間を割くべきより強い要請があった。

Churchは、GPT-6 Astraの実行時間を約6時間、自身の作業を数晩分用いたと報告している。モデルが労力をなくしたわけではないが、誰がこのプロジェクトに挑戦できるかを変えた。

Churchは、これまで暗号を解いた経験はなかったと述べる。彼の役割は、従来の暗号解読者というより、調査者、監督者、検証者に近かった。

これが、この物語の主な逆転である。AIは、集中して取り組んだ専門家世代を退けてきた暗号を打ち破ったわけではない。

むしろ、継続的な専門家の注目をほとんど逃れてきた文書に取り組んだ。ボトルネックは純粋に数学的なものではなく、経済的・組織的なものだった。

この違いは、この事例の重要性を下げるどころか、むしろ高める。アーカイブには、技術的には復元可能でありながら、個別に処理するにはコストが高すぎる文書が大量に蓄積されている。

汎用モデルは、こうした作業を始めるコストを下げられる。スキャンを調べ、転写案を提示し、関連記録を探し、分析コードを書き、仮説を修正できる。

その出力は、歴史家、言語学者、アーキビスト、暗号研究者に引き渡され、的を絞ったレビューを受けられる。専門家は、最初の実用的な草案を作る時間を減らし、重要な主張を検証する時間を増やせる。

マルモン暗号は、モデルが整合していないカタログ間の資料を結び付けられることも示している。部分鍵と暗号版は、不統一な名称のもとで異なる場所に存在していた。

人間の探索者も同じ接続を見つけられた可能性がある。モデルの強みは、1つの作業文脈の中で手掛かりを探し、検証し、統合し続けられることにあった。

この能力は、暗号研究以外にも応用できる。歴史研究では、異綴りの名前を対応付けたり、繰り返される定型表現を特定したり、損傷した文書を既知の書簡と比較したりすることに依存する場合が多い。

難読な筆跡、私的な速記、部分的にしか理解されていない文字体系、そして研究チームが索引化する時間をまだ得られていない行政記録にも役立つ可能性がある。

歴史的暗号解読に計算支援を活用した前例はすでにある。研究者たちは、米国のジェームズ・ウィルキンソン将軍に関する書簡を含め、18世紀の辞書式暗号を復元するためにニューラル言語モデルを用いてきた。

それらのシステムは通常、明確に定義された暗号解読タスクを対象としていた。GPT-6 Astraによるナポレオン暗号の事例は、史料画像から検証パッケージに至るほぼ全工程をモデルが組織したと報じられている点で、より広範に見える。

だからこそ、「Another Historic Cipher Falls to AI」を、チャットボットがフランス語をいくらか推測したという主張に矮小化すべきではない。このシステムは、画像認識、検索、プログラミング、統計、歴史的解釈をまたぐコーディネーターとして機能した。

また、この成果は数十年にわたる人間の仕事にも依存していた。Tantは部分的な表を作成し、Tomokiyoは未解読暗号のカタログを管理し、アーキビストは日誌をデジタル化し、編集者はナポレオンの書簡を保存してきた。

これらの資料がなければ、モデルは出発点となる手がかりも、最も有力な検証材料も得られなかっただろう。

解読された書簡が実際に新たにもたらすもの

この書簡の歴史的価値は、伝達の確認、小さな空白の補完、そしてナポレオン司令部が迫る戦争をどのように位置づけていたかを示す点にある。

この急使文は、著名なナポレオン派の人物が指揮する兵力を列挙している。ダンツィヒ公の指揮下にある4万人のバイエルン兵を、ミュンヘンとパッサウの間に配置している。

また、ユゼフ・ポニャトフスキ公の指揮する3万人のポーランド兵を、クラクフ近郊のヴィスワ川に割り当てている。ドレスデン手前のザクセン軍と、バイロイトにいると報告された8万人のフランス軍にも言及している。

さらに、ウルムとドナウヴェルト周辺の6万人、およびアウクスブルクとレヒ川の近くにいるニコラ・ウディノ将軍指揮下の4万人にも触れている。

これらの数字は、ナポレオンが3月16日に出した指令を再現している。現代の歴史研究によって裏付けられた正確な兵員数として、直ちに扱うべきではない。

ポーツマス大学のリサーチフェローであるZack Whiteは、historical analysisに対し、ナポレオンが実際に動員可能だった兵力は、この文書が示す数より約6万人少なかったと語った。

この食い違いは、文書の読み方を変える。それは単なる客観的な兵力一覧ではなかった。

この書簡は、孤立した指揮官に向けた説得でもあった。その規模と自信に満ちた表現は、フランスの優位がなお圧倒的だとマルモンに信じさせる意図を持っていた。

書簡は、ロシア軍がオーストリアに向けて進軍しているとしている。他の書簡からは、ナポレオンがロシアが予想どおりに動くと確信していたわけではないことが分かる。

したがってこの急使文は、特定の時点における公式の物語を捉えている。敵対行為が始まる前に、ウジェーヌの司令部がマルモンに何を信じさせようとしていたかを示している。

その物語は、オーストリアの民兵も軽視していた。解読文は、住民を鼓舞する試みがなされたものの、集められた兵員は軍を有効に補強できることを示していないと述べている。

報道によれば、文書で言及されたオーストリア側の地点は軍事状況と整合する。これは、ウジェーヌの司令部が敵軍の配置について意味のある情報を保有していたことを示唆する。

「ならず者の集まり」に関する復元箇所も、もう一つの小さな貢献を加える。この表現は、ナポレオンの3月16日付命令の印刷版にある欠落部分に対応する。

暗号化された急使文はその命令を言い換えたものなので、失われた語句を完全な確実性をもって復元することはできない。それでも、意図された意味を明らかにしている。

キングス・カレッジ・ロンドンで欧州史を研究するMichael Roweは、既知の命令を一種のロゼッタ・ストーンになぞらえた。既存の書簡は、暗号文の大部分に何が含まれるべきかを研究者に示している。

そのため、この書簡はAIによる解読を評価するのに特に適している。外部の対照が存在する場面で手法が機能すれば、研究者はそれほど馴染みのない文書で検証するための、より強固な根拠を得られる。

Roweはまた、この結果がまったく未知の軍事計画を明らかにするものではないと指摘した。中心的な情報の大半は、すでにナポレオンの書簡に含まれていた。

むしろこの書簡は、命令を受け取る側を記録している。歴史家は、ナポレオンの指示と、ウジェーヌの司令部が実際に何を伝達したかを比較できる。

また、155種類の記号を含む実用的な鍵も残された。この取り組み以前に公表されていた表には、33の文字値しかなく、単語記号は含まれていなかった。

同じシステムを用いた別の文書が見つかれば、研究者は復元された鍵から始められる。この将来的な再利用は、この書簡の直接的な内容より価値あるものになるかもしれない。

AIによる解読になお人間の説明責任が必要な理由

一貫性のある翻訳は証拠となるが、それが歴史的知識になるかどうかを決めるのは、再現性、来歴、そして専門家による批判的検証である。

言語モデルは、完成されたように見える文章を生成することに非常に長けている。歴史資料の解読では、その強みが弱点になり得る条件が生まれる。

損傷した画像、不完全な鍵、予想される主題は、曖昧な証拠をもっともらしい物語へと無理に寄せる機会をモデルに数多く与える。

この事例は、いくつかの独立した検証によってその危険を減らしている。提案された鍵は暗号文全体で一貫して対応し、解読された兵力一覧はナポレオンの記録された命令と一致する。

軍事的文脈は、1809年という改訂された日付を支持している。Tomokiyoが作業をレビューし、コードと証拠ファイルは検証できるよう公開されている。

既存の報道も、この文書を一般的な語り直しと区別している。contemporary accountは、この書簡がナポレオン本人ではなくウジェーヌの司令部から発せられたものであることを確認している。

とはいえ、この作業はまだ広範な査読を受けていない。現存する画像は低解像度で、一度しか現れない記号もある。

そうした希少な記号は、反復によって検証できない。その意味は、文法、文脈、周辺の復元作業により大きく依存する。

既知のナポレオンの命令は、別の複雑さももたらす。優れた検証用対照となる一方で、探索にバイアスをかける可能性もある。

予想される兵力一覧をすでに知る解読者は、原命令に似た言語を再構成できるかもしれない。したがって研究者は、画像上の証拠と文脈からの推論を分けなければならない。

Churchは、再実行結果と検証資料を公開することでこの懸念に対処した。報道によれば、そのパッケージには、解読システムのコーパスからナポレオンとの比較文書を除外して実施したテストが含まれる。

この設計は有用である。なぜなら、暗号解読システムが最も明白な歴史的参照を単に反復することなく、メッセージを復元できるかを問うものだからだ。

より大きな教訓は説明責任に関わる。ChurchはLive Scienceに対し、解を検証することは生成することより困難だったと語り、説明責任を単純に自動化することはできないと付け加えた。

この指摘は、AI支援によるあらゆるアーカイブ上の主張に当てはまる。モデルは解釈案を迅速に提示できるが、証拠がそれを支持するかを判断しなければならないのは人間である。

有用な基準には、追跡可能な原資料画像、記録された転写プロセス、明示的な不確実性、再現可能なコード、独立した記録との比較が含まれるべきだ。

研究者は失敗した仮説も保存すべきである。最終的に整った物語は、どれほど多くのもっともらしい代替案が検討され、退けられたかを隠してしまう可能性がある。

機関には、功績の帰属に関するより明確なルールが必要になる。AI支援による解は、カタログ管理者、アーキビスト、先行する暗号研究者、ソフトウェア開発者、歴史家、モデル運用者に依存している可能性がある。

この成果を自律的なAIの発見と呼べば、それらの貢献を消し去ることになる。通常の手作業による研究と呼んでも、何が変わったのかを見落とす。

最も正確な説明は、人々によって導かれ、検証されたAI支援解読である。モデルはワークフローを圧縮し、人間の研究者は来歴、判断、責任を担った。

この手法が拡張可能かを示す三つのシグナル

次の試験は、手がかりが少なく、歴史的対照も弱い文書で研究者が同じ結果を再現できるかどうかである。

第一のシグナルは、155記号の鍵の再利用である。研究者は、同じシステムを使用するウジェーヌの司令部またはマルモンに関連した別の書簡を探すべきだ。

適用に成功すれば、特に現在の文書で一度しか現れない記号について、記号の対応付けが強化される。また、暗号が通信相手や日付によって変化したかどうかも明らかになる可能性がある。

第二のシグナルは、独立した再現である。別のチームが原資料スキャン、部分表、公開された手法から開始し、フランス語の本文を再現すべきだ。

そのチームは記号レベルでの相違を記録する必要がある。英語の表現が完全に一致することより、中心的なメッセージで一致することの方が重要である。

第三のシグナルは、既知の並行テキストを持たないアーカイブ暗号での性能である。マルモン宛ての書簡は、内容の多くを予測できるナポレオンの3月16日付命令の恩恵を受けている。

制約の少ない事例であれば、ワークフローが本当に一般化できるかを検証できる。同時に、説得力はあるが根拠のない解釈のリスクも高まる。

成功とは、モデルが流暢な文章を生成することではない。安定した鍵が暗号文を説明し、専門家の検査に耐え、関連する証拠でも機能することを意味するべきだ。

より広い可能性は大きい。多くの歴史的難問は、大きな発見を保証しないまま専門家の何週間もの労力を要するため、未解決のまま残されている。

AIは、こうした見過ごされてきた問題を調査可能なコストにできる。部外者が検証可能な初期解釈を作るのを助ける一方で、専門家の注意を最も難しい不確実性へ向けることができる。

しかし、解決が速くなれば第二の滞留、すなわち検証作業の滞留が生まれる。カタログ管理者や歴史家には、評価できる速度を上回るペースで解読案が届くかもしれない。

その不均衡は、早すぎる主張で公開討論を満たしてしまう可能性がある。したがって再現可能な証拠パッケージは、任意の補足資料ではなく、成果そのものの一部にならなければならない。

「Another Historic Cipher Falls to AI」は、その作業を検証できるからこそ信頼できる節目である。不確かな記号から既知の歴史的命令への依存まで、その限界もまた見えている。

次の飛躍も、同じ基準で判断されるべきだ。独立した研究者が解釈を再生成し、弱点を検証し、別の場所に手法を適用できるのか。

答えがイエスなら、AIは孤立した歴史的珍事を解くだけではない。研究者が調査できるだけの余力を持てる、これまで見過ごされてきたアーカイブそのものを変えるだろう。

 
 

無料で始めましょう

ローカルファーストのパーソナル知識管理付きAIアシスタント

より良いAI体験のために、

remio は現在、 Windows 10+ (x64)とM-Chip Mac のみをサポートしています。

仕事のAIパートナー
remioでもっと仕事が進む

計画・作成・仕上げまで
すべてをひとつに

bottom of page