top of page

Fable 5.1によるCyphral Distich解読、厳しい検証試験に直面

9月14日
読了時間: 18分

Fable 5.1は、1653年の書籍に関連する謎であったCyphral Distichを44分で解読したと報じられている。Fable 5.1 Cyphral Distichの結果が並外れて説得力を持って見えたのは、提案されたメッセージが暗号の構造と著者の政治的立場に合致していたためだ。その後、研究者らが現存する異なる写本を調査し、証拠に異議を唱えたことで、明快な勝利譚はAI研究の基準を試すケースへと変わった。

8月31日の報告を発表したのはAnthropicでも学術暗号研究チームでもなく、AI評価企業のVals AIだった。Valsによれば、Claudeモデルは追加の人間による介入なしに176,000トークンを処理したという。同社は、64個の数字をチャールズ2世を支持する二行の祈りへと変換する、単純な索引規則を提案した。

この説明はもっともらしく、記憶に残り、一部は再現可能でもある。しかし初期の再現試行では、あるデジタル化された1653年版には暗号がなく、基礎となる本文も異なることが判明した。後の調査では、Distichを含むと報じられた別の現存本が特定された。現在の争点は、版、正確な入力、そして解読されたすべての文字を独立して再構成できるかどうかにある。

Fable 5.1が実際に発見したもの

モデルの中心的な洞察は、暗号の鍵が独立した暗号アルファベットではなく、周囲の書籍そのものにあるように見えたことだった。

サー・トマス・アーカートのCyphral Distichは、32個の数字からなる二行で構成される。distichは二行詩を指し、cryptogramは定義された符号化規則によって隠されたメッセージを指す。このパズルは少なくとも1899年以降、歴史的な議論に登場してきたが、受け入れられた解法はなかった。

cipher experimentによると、Fable 5.1はこの二つの32数字列を、Proquiritationsと呼ばれる32の節と結び付けた。これらの文章は、アーカートの願い、欲望、あるいは希望を表している。アーカート自身も、周辺の本文で数字の32に注意を向けていた。

提案された規則は機械的だ。いずれかの暗号行の最初の数字について、読者は最初のProquiritationを参照する。その数字が当該節内の単語を選び、その単語の頭文字が平文の文字となる。二つ目の数字は二つ目のProquiritationを指し、これが32の位置すべてにわたって続く。

この規則を両方の行に適用すると、神にチャールズ2世を支え、この地の最高統治者とするよう求めるメッセージが得られる。「Charls」という綴りは、明白な現代的修正ではなく、17世紀の用法と整合している。

この解読案を説得力あるものにしている特徴はいくつかある。解読された各行は32文字で、32個の数字という構造と一致する。行末の語は韻を踏み、distichに期待される形式を満たしている。メッセージはまた、アーカートが文書で確認されている王党派への忠誠も反映している。

アーカートが執筆したのは、チャールズ1世の処刑後の時期だったため、政治的文脈は重要である。関連作品が出版された当時、チャールズ2世はなお権力の座に就いていなかった。彼の王政復古を求める隠された訴えは、著者と時代の双方に符合する。

Valsによれば、モデルは44分と176,000トークンを経てこの解釈に到達した。オペレーターのGeby Jaffは、大まかな目標と初期の励ましを与えたとされるが、成功した実行中には介入を行わなかったという。

この実験は、あらかじめ選んだ固定目標を持つブラインドベンチマークではなかった。Jaffはモデルに対し、合理的に検証可能な答えが見込める未解決暗号を選ぶよう求めた。また、Kryptos K4のような極めて難易度の高い対象からは遠ざけた。

この違いは結果を無効にするものではないが、結果が何を測定したかを変える。セッションでは、問題選定、オンライン調査、仮説形成、粘り強さ、自己検証が一体として試された。統制された比較を通じて暗号解読能力だけを切り出したものではない。

モデルはアーカートのパズルに落ち着く前に、複数の候補を検討したようだ。Valsはまた、他の最先端モデルが以前の試行で検証済みの解を出せなかったとしている。同社は、すべてのモデル、プロンプト、候補、不成功の実行を示す完全な母数を公開していない。

その情報がなければ、44分という数値は一つの成功軌跡を表すにすぎない。Fable 5.1が類似の歴史的パズルを解ける一般的な確率を立証するものではない。

Fable 5.1 Cyphral Distichの仕組みこそが本当の要点

重要な能力は総当たりではなく、文書の構造、言語、歴史的文脈を検証可能な規則へと結び付けることだった。

従来の攻撃手法では、この数字を外部の暗号システムへの入力として扱っていたようだ。研究者は換字、頻度分析、関連技法を検討した。こうした手法は、数字列が別の鍵を介して文字や記号に対応すると仮定する。

それに対してFable 5.1は、文書をデータ構造として扱った。初期シグナルとなったのは数の一致だった。各行に32の番号付き位置があり、近くには32のProquiritationsがある。願いを繰り返し表す言葉は、導入詩とそれらの節の意味的なつながりを示した。

これは従来型の暗号解読というより、アーカイブ調査に近い。モデルには、関連資料の取得、本文上の特徴の比較、数的対応の発見、索引手順の提案、出力の検証が求められた。

規則は一度説明されると簡単に聞こえる。その見かけの単純さが、探索問題の難しさを覆い隠すべきではない。歴史研究者は、書籍の物理的な構成に埋め込まれた手がかりを見落としたまま、洗練された手法に何年も費やすことがある。

したがって、このFable 5.1による暗号解法は、有用な機械支援の一類型を示している。モデルは、複数の弱い手がかりを保持しながら文書間の煩雑な組み合わせを探索できる。また、歴史的仮説を位置ごとの検証に変換するスクリプトも書ける。

これは娯楽的な暗号学にとどまらず重要である。同様の作業は、歴史地図の分析、写本比較、科学文献レビュー、ソフトウェア考古学、散在する記録を含む調査に見られる。

研究者は、何千ページもの資料、不統一な綴り、不完全なスキャン、複数のもっともらしい版を抱えることがある。難しい部分はしばしば、適切な資料断片を適切な検証と結び付けることにある。モデルは、その探索を非現実的なものから、単に時間のかかるものへと変えられる可能性がある。

technical discussionのコメントには、興奮と慎重さの両方が表れていた。一部の読者は、これまでデータ入力の負担ゆえに現実的でなかった、見過ごされてきた歴史プロジェクトでモデルを使うことを語った。ほかの読者は、実験の母数や、自由形式のブラウジング後に選ばれた答えの信頼性に疑問を呈した。

この分かれ方が本質的な意義を捉えている。この出来事は、言語モデルが歴史研究を習得したことを示すものではない。人間の注意が乏しい領域で、真剣に検討すべき候補発見を生み出せることを示している。

候補を生成することと、発見を確立することの区別は不可欠だ。首尾一貫した解釈は研究の始まりであり、最終段階ではない。解釈が説得力を増すほど、その導出はより慎重に検証されるべきである。

これは、モデルがオンライン検索できる場合に特に当てはまる。その学習データや取得したページには、忘れられた手がかり、部分解、後年の転記が含まれている可能性がある。Valsはこのパズルを未解決と説明しているが、公開された説明には、モデルがアクセスしたすべてのページを監査するのに十分な情報がない。

そのため、公開証拠と両立する説明がいくつか残される。Fable 5.1が索引化の洞察を最初に生み出した可能性がある。歴史的議論にある埋もれた手がかりを再結合した可能性もある。認識されていない先行提案を見つけた可能性もある。完全なツールおよび取得履歴があれば、これらの可能性を区別する助けになる。

いずれも、提案された平文を自動的に誤りにするものではない。影響を受けるのは、何世紀にもわたって人々を退けてきた問題をモデルが独立して解いたという、より強い主張である。

この事例は、研究文脈を保存する重要性も浮き彫りにする。有用なsearchable knowledge baseでは、資料の版、ノート、導出記録をまとめて保持すべきだ。そうでなければ、説得力ある結果が、それを生み出した資料から切り離されかねない。

第二の暗号は根拠を強める一方、賭け金も高めた

Fable 5.1は同じ発想をより大きなアーカート暗号にも拡張したと報じられ、仮説への支持を増す一方で、未解決の境界も明らかにした。

アーカートはCyphral Octastichとして知られる別の数値パズルも残している。octastichは八行詩を指す。この第二のパズルは1652年に刊行された作品The Jewelに登場し、末尾の資料を含めると285個の数字からなる。

モデルは、The Jewelに284の番号付きページがあることに着目したと報じられている。そして、連続する各暗号数字が対応するページ内の単語を索引化すると提案した。その単語の頭文字が、隠された詩の一文字になる。

これにより、別の王党派の祈りの大部分が得られた。その行はチャールズ2世、王家、簒奪された権威への反対に言及している。復元されたテキストは、ABABABCCの押韻構成を持つ八行詩形ottava rimaのパターンに従っている。

関連する仕組みを用いた二つ目の結果は、Distichの出力が無制限なパターン照合だけから生じた可能性を低下させる。提案された二つのメッセージは、著者、政治的立場、文学形式、書籍索引の設計を共有している。

ただし、Octastichは完全な解読ではない。Valsは第5行に判読不能な文字が9個あると報告した。提案された抽出ではまた、「IRISH」が期待される箇所に「IRSH」という列が現れる。

さらに複雑なのは、158番目の位置以降である。159番目以降、成功した読みでは、元の規則から期待されるページではなく、その前のページが使われていると報じられている。Valsは、ページ選択の重複や印刷されたページ番号の重複を説明候補として示した。

こうした不規則性が必ずしも致命的とは限らない。近世の印刷書籍には、綴りの揺れ、組版ミス、損傷ページ、現存本間の差異が含まれる。現代の転記では、欠落文字、結合された単語、ハイフン処理の不統一によって、さらに誤りが持ち込まれることがある。

しかし例外が増えるほど、透明な証拠の必要性も高まる。本文が難しくなった時点で変化する手法は、解読から再構成へとずれ込むおそれがある。研究者は、平文が現れる前にどの選択が決まっていたのかを確認する必要がある。

Valsの説明によれば、判読可能なOctastichの275位置のうち231は、各ページで最初に該当した単語の出現箇所と一致した。残る44は、特定可能な転記差異のためとされ、1〜3語の範囲に収まったという。

このパターンは興味深いが、公開された投稿は完全なパッケージを公開するのではなく、内部スクリプトやファイルに言及している。読者は、モデルが説明した正確な入力を使い、285の座標すべてを独立して調べることはできない。

その後の調査は追加の支持をもたらしている。Bruce Schneierによるcipher coverageのコメント投稿者は、現物の1652年グラスゴー版の研究用スキャンと照合し、重要なOctastichの位置を確認したと報告している。

その検証は、149番から157番の位置にある難しい連続部分を再現したと報じられている。また、158番以降の文字についても、提案されたずれを裏付けた。研究者は、ある座標は改行された単語をどう数えるかに依存すると注意を促した。

これにより、Octastichに関する主張の一部は、もっともらしく聞こえる平文だけを超えたものとなる。ただし、検証が完了したわけではない。特定された現物の写本・印刷本から、座標ごとに完全な再構成を行うことが、依然としてより強い基準である。

したがって、このより大きな謎は、裏付けの証拠であると同時に警告でもある。Fable 5.1がUrquhartの暗号群に実際の類似性を見出したことを示唆する一方で、歴史的テキストの異同が、一見機械的に見える解法をいかに急速に複雑化させるかも示している。

最初の反証が版の問題を浮き彫りにした

最も鋭い異議は、単にモデルが幻覚を起こしたと非難するものではなかった。公開された説明が、特定のデジタル化された現存本と照合すると成り立たないことを示した。

Valsの投稿が公開された直後、ReticuliはBritish LibraryのフィルムとEEBO-TCPの転写を用いた再現試験を公開した。この試験では、重大な不一致が二つ報告された。

第一に、調査した1653年刊本は、Valsが説明した箇所に二つの番号付き行を含まずに終わっていた。末尾には第32のProquiritation、エピグラフ、終止記号、そして正誤表が含まれていた。

第二に、その刊本のProquiritation本文からは、主張された平文に必要な複数の文字を生成できなかった。特に取り上げられた例は、「KING」の「K」だった。対応する箇所には、Kで始まる単語がないと報じられた。

研究者は、トークン化、索引付け、節の対応付け、文字選択に関する65通りの組み合わせを検証した。最良の結果でも、提案された64文字のうち一致したのは8文字だけだったという。再現可能なコードと証拠は後に公開のreplication bundleに置かれた。

これは、復号文のもっともらしさではなく導出過程そのものを標的にしたため、重要な異議だった。長さと韻が正しい王党派の対句であっても、示された索引から生成されないのであれば誤り得る。

この異議は当初、物語全体を覆すように見えた。引用された書物に暗号が存在せず、元テキストにも必要な単語がなければ、その解法は版の混同、あるいは根拠のない再構成を反映している可能性があった。

その後の情報は、この判断を複雑にした。Schneierのサイトでコメントした研究者によれば、National Library of Scotland所蔵の現存する1653年刊本にはDistichが含まれているという。British Libraryの現存本には、別の本には存在する資料が欠けているようだ。

こうした違いは近世初期の印刷ではあり得る。同一版とされる本でも、異なる刷り紙、取消し、追加の葉、訂正文、あるいは異なる製本履歴を持ち得る。デジタル化された現存本は、その一冊についての証拠であり、印刷部数全体を自動的に代表するものではない。

後の報告では、Distichの仕組みは1834年版で用いられたProquiritationの順序に対して再現できるともされた。これは、初期の反証が正当ではあるものの互換性のない現存本を検証していた可能性を示す。

この出来事は、反証を無意味にするものではない。むしろ、元の発表における大きな弱点を明らかにしている。Valsは、別の研究者がただちに同じ入力を選べるほど明確に、正確な現物またはデジタル化された現存本を特定していなかった。

暗号文が1653年の著作の末尾に現れるという記述は、範囲が広すぎた。一部の現存本には、それが含まれていないと報じられている。この本のProquiritationも、関連する資料間で文言または順序が異なる。

これは来歴の問題、すなわち資料がどこから来て、どのように変化したかに関する問題である。来歴は、数値索引がどのテキストを参照するかを決める。たった一つの追加句でも、節内のそれ以降のすべての単語番号をずらし得る。

通常の読書では、二つの版は実質的に同じ考えを伝えるかもしれない。しかし書籍暗号にとっては、それらは異なる暗号学的オブジェクトである。句読点、ハイフネーション、ラテン語句、印刷者の判断は、出力を変え得る。

したがって、初期の反証と後の訂正はいずれも同じ教訓を示している。AI支援による歴史的発見には、正確な資料識別子が必要だ。手法が単語位置に依存する場合、書名と刊行年だけでは不十分である。

説得力のある平文は完全な検証ではない

Fable 5.1による暗号解読には強い内部的証拠があるが、その公開文書はなお完全な独立監査の水準に達していない。

提案されたDistichのメッセージには、互いに独立して見える複数の検証要素がある。ちょうど32文字の2行を満たし、末尾の語は韻を踏み、その政治的内容はUrquhartの王党派思想と整合し、その仕組みは暗号文を近接する32の節と結び付けている。

これらの特性により、偶然の一致である可能性は低くなる。また、この答えを感情的に満足させるものでもある。書物そのものが鍵だと誰かが気づけば、数世紀前の謎が容易に解けるようになる。

しかし、その満足感は検証の罠になり得る。研究者は、意味のある結果を、すべての中間段階が正しく機能した証明として扱ってしまうかもしれない。言語モデルは、部分的な証拠の周囲に首尾一貫した物語を作ることに長けているため、このリスクを強める。

最も強い検証では、正確なスキャン識別子、外交的転写、トークン化方針、そして64件すべての位置対応を公開する必要がある。外交的転写は、機械的な確認に十分な精度で、原綴りやテキスト上の特徴を保存する。

各対応は、暗号位置、選択したProquiritation、数値索引、得られた単語、抽出文字を特定すべきである。曖昧な事例は、黙って正規化するのではなく、明示的に示すべきだ。

次に、第二の研究者が、提案された平文を最初に見ずに出力を再現すべきである。これにより、無意識のうちに期待する答えへ近づける解釈上の選択から守ることができる。

この過程では、1653年の現存本と1834年の全集版も区別すべきである。手法が後年の順序または文言に対してのみ機能するなら、研究者はそのテキストが元の暗号とどう関係するかを説明しなければならない。

未解決のラテン語の数え方に関する詳細も、同様の扱いに値する。報告によれば、少なくとも一つの座標は、ある句を一単位として扱うことに依存している。その判断には、求める文字とは独立したテキスト上または組版上の根拠が必要である。

Valsは記事の冒頭近くで慎重な表現を用い、モデルが暗号を解いた「ように見える」と述べている。一方、見出しや提示方法では、より断定的な言葉を採用している。この緊張関係は、AI能力に関する報道でよく見られる。

見出しには明快さが求められる一方、研究には不確実性が求められる。その結果、狭い留保を伴いながらも、強い公開上の主張となることが多い。読者が記憶するのは解決された謎であり、未解決の資料対応ではない。

Anthropicの役割についても明確にしておくべきだ。Fable 5.1はClaudeモデルだが、この実験を設計し報告したのはValsである。ここで検討した公開資料は、この暗号の結果をAnthropicのベンチマークや査読済みの発見とはしていない。

モデルの性能は、それを取り巻くエージェントシステムから切り離せない。検索アクセス、プロンプト、コンテキスト管理、ツール、トークン予算、そして運用者の選択基準が、すべて結果を形作った。

したがって、この実行を自律的と呼ぶのは過大評価になる。報告された44分間の軌跡では人間の介入はなかったが、人間が目的を設定し、野心的な問題選択を促し、探索空間を制約した。

最も正確な説明は、Valsが大部分で自己主導的な研究実行を引き出した、というものだ。モデルは人間が定めた境界の中で、扱いやすい歴史的暗号を選択し調査した。

それでも印象的である。また、開発者や企業の購入担当者にとって、より有用な説明でもある。実際の研究システムは、孤立したチャット応答ではなく、足場となる仕組み、検索、権限、レビューを通じて機能する。

未解決の問いは、モデルが価値ある仕事を生み出したかどうかではない。モデルが真剣な調査に値する仮説を生み出したことは明らかだ。完全な導出が公開される前に、コミュニティがその仮説を解決済みの暗号と呼ぶべきかどうかが問われている。

研究者が次に注視すべきこと

これが検証済みの歴史的発見になるのか、それとも不完全なAI研究報告の警告例になるのかは、三つの展開によって決まる。

第一のシグナルは、特定の現物に結び付けられた、公開された64位置のDistich再構成である。記録には、スキャンまたは安定した目録参照、正確な節本文、数え方の規則、抽出された文字が含まれるべきだ。

独立した研究者が64文字すべてを再現すれば、Fable 5.1 Cyphral Distichに関する中核的な主張は大幅に強まる。再構成に、出力に合わせた例外を繰り返し必要とするなら、信頼度は下がるべきである。

第二のシグナルは、完全なOctastich監査である。Glasgowの現存本に対する部分的な検証は、すでに提案された仕組みの重要な部分を裏付けている。残る課題は、判読不能な領域とページずれを含む285の座標すべてを検証することだ。

監査に成功すれば重要な意味を持つ。第二の暗号は、関連しているものの、より大規模な試験を提供するからだ。それは、モデルが魅力的な一文を一つ当てはめたのではなく、Urquhartのより広範な符号化の実践を特定したことを示すだろう。

失敗しても、Distichが自動的に否定されるわけではない。しかし主張は一つの謎に限定され、共通する著者の仕組みが両作品を説明するという議論は弱まる。

第三のシグナルは、Valsまたは同様の評価グループによる実験開示の改善である。有用な記録には、最初のプロンプト、検討された候補の謎、失敗した実行、完全な検索履歴、モデル設定、生成された検証ツールが含まれる。

フロンティアモデルの実演を解釈する際、この分母は重要である。単発の成功セッションは、それまでに失敗が2回あったのか、200回あったのか、あるいは大規模な人間による選別があったのかで、異なって見える。

透明な開示は、モデル能力とハーネスの品質を区別する助けにもなる。開発者は、持続性、コンテキスト長、検索戦略、自己生成コードのどれが優位性を生んだのかを検討できる。

この事例を、信じる者と懐疑論者の対決に矮小化すべきではない。初期の批判者は実際の資料不一致を見つけた。後の調査者は、その不一致が存在しない暗号ではなく、現存本の異同を反映していたことを示す証拠を見つけた。

どちらの段階も記録を改善した。主張が正式な出版より速く進むとき、健全な検証とはこういうものだ。

ナレッジワーカーにとって、当面の教訓は実践的である。AIは現在、見過ごされてきた文書を、はるかに低いコストで検証可能な研究の手掛かりへと変えられる。構造を比較し、検証コードを書き、人々がしばしば放棄する作業を継続できる。

それに対応する義務も同様に実践的である。正確な入力を保存し、変換を記録し、観察と解釈を分け、重要な結果は別の人に再現させることだ。

Fable 5.1は、意義を持つために暗号学者を置き換える必要はない。専門家が他の方法では追究する時間を持てない仮説を、浮かび上がらせればよい。その役割は、社会が調査するアーカイブ資料の量を拡大できる。

しかし、速度は来歴の代わりにはならない。44分間の答えは発見を始められるが、最終的な主張は、すべての資料とすべての文字を確認する、より遅い過程に属する。

次の節目は、また別の劇的なモデル実演ではない。退屈だが完全で、独立して再現可能なワークシートである。その記録が提案された平文を裏付けるなら、暗号の長い沈黙は、機械による探索と人間による検証の協働によって終わることになる。

それまでのところ、最も正確な結論は慎重な評価にとどまる。Fable 5.1は説得力のあるCyphral Distichの仕組みを見いだしたようであり、その後の証拠によって当初の批判の一部には答えが示された。完全な公開監査によって、「解決済み」が歴史的事実なのか、それとも魅力的な暫定ラベルなのかが決まるだろう。

 
 

無料で始めましょう

ローカルファーストのパーソナル知識管理付きAIアシスタント

より良いAI体験のために、

remio は現在、 Windows 10+ (x64)M-Chip Mac のみをサポートしています。

仕事のAIパートナー
remioでもっと仕事が進む

計画・作成・仕上げまで
すべてをひとつに

bottom of page