日本語訳 · 原著 Daniel Bourdeau『Unsolved Historical Ciphers』は CC BY 4.0 で公開されている。本ページは JIC による翻訳で、原著者の公式版ではない。訳文に相違がある場合は英語原文が優先する · 英語原文を見る ↗
4 · pot · 97 · 400 | 806 845 61 407 850 900 740 = 角のある射手
255 435 690 740 · 705 33 520 · 名前 + 語尾、改行で分割されることはない

モヘンジョダロ、ハラッパーほか50遺跡 · 表語音節文字、受け入れられた解読はない · 紀元前2600–1900年頃 · 試行、未読

インダス文字:Parpola の解読と2,727件の登録済みテスト

Parpola のドラヴィダ語による読み、そして検証前に登録した2,727の仮説。線文字Bとウル第3王朝の印章を対照実験として、互いに独立した2つのコーパスで検証した。読みが従うべき文法は明らかにしたが、音価は1つも確立していない。

Daniel Bourdeau · 投稿 · 更新

方法:未解読 · 範囲:本文は得られず

要点未解読 · 登録した仮説2,727件中1,425件が成立

テキスト
出発点は Asko Parpola の講演「Study of the Indus Script」(ICES 東京 2005年、harappa.com 掲載)である。その背後にある銘文は約4,500点の印章、タブレット、土器片で、大半は5文字に満たない。
所蔵
互いに独立して作られた機械可読の転写が2つある。Interactive Corpus of Indus Texts(ICIT。Wells と Fuls)から派生したデータベースと、Mahadevan の1977年のコンコーダンス(M77)である。ここでは両者を文字ごとに対応づけた。Parpola 自身の Corpus of Indus Seals and Inscriptions のデジタル化版を第三の検証に用いた。
文字体系
約400–600の文字で、大半は右から左へ書かれる。語の区切りも、二言語併記の資料もなく、言語もわかっていない。
試みた方法
まず、Parpola の講演と彼の1994年の読みの表にあるすべての数を数え直し、彼のタミル語による検証に偶然の基準線を与えた。次に、データを見る前に247組、計2,727の仮説を書き出して確定させた。それぞれを検証し、成立したか失敗したかを記録した。主要な結果は、取り置いておいたサンプルと、読むことのできる2つの文字体系(線文字B、ウル第3王朝の楔形文字)に対して再度検証した。
得られたもの
音価のない詳細な文法。名前はある枠で終わり、その形(740、520、あるいは閉じ記号)は名前の最後の文字によって選ばれる。書記は結びついた対や、名前とその語尾を、決して行をまたいで分割しない。数字は、数える対象の文字と固定的に結びついている。印章の名前は個人名のようにふるまい、同じ長さの線文字Bの名前と同様である。Parpola の星の名前の読みは、それぞれ1つか2つの印章に依拠している。
未解決
音に関わることすべて、そして言語。タミル・ナードゥ州の賞金が求めるもの(12節)に照らすと、解読を決定づける段階はほぼゼロである。本プロジェクト自身の以前の結論のいくつかは、後の検証によって撤回された。それらは14節に挙げている。

01 コーパスと文字

Parpola の論拠は数である。最も多い文字がどれほど頻繁に現れるか、どの文字が並び、どの文字が決して並ばないか。それを再検証するために、本プロジェクトは互いに独立して作られた2つの転写を使った。1つ目は Interactive Corpus of Indus Texts(Wells と Fuls)から派生したデータベースで、indus-website プロジェクトとともに公開されている。2,543点の対象、11,253文字で、CISI の対象番号、遺跡、図柄が付いている。同じデータベースのより完全な書き出し(5,680件の記録で、出土地点、層位、大きさ、材質を含む)を、後の検証の大半に用いた。その文字の総数は、確認した文字について、Fuls の Catalog of Indus Signs(2023年)に印刷された数とよく一致する。ICIT の文字は番号でしかないので、各文字をデータベース自身のフォントで描き、Parpola の記述と照合して同定した。2つ目の転写は Mahadevan の1977年のコンコーダンス(2,906テキスト)である。2つの文字リストは、両者に共通するテキストを揃えることで対応づけた。991行で、文字の96%がただ1つの対応物をもつ。1つ目のコーパスにない M77 の1,664テキストは、全体を通じて独立した再現用サンプルとした。

このページで扱う文字と、その ICIT 番号
このページで扱う文字と、その ICIT 番号と出現数:壺 740、魚の系列(無印の 220、「屋根」付きの 235、233、231、240)、蟹 798、イチジク 772–786、イチジク + 蟹の合字 777、目、二重曲線、鉢 700、数字、そして銅板の文字 806 845 61 407 850。画像:ここで indus-website のフォントにより描画(ICIT の文字番号)。

02 講演の主張を検証する

モヘンジョダロ出土の棒状印章 M-414 の押印
M-414、モヘンジョダロ出土の棒状印章の押印。右から左へ読むと、不明瞭な交差した文字、枝に横線のある U 字形の「イチジク」、無印の「魚」となる。これが Parpola の2つ目の「イチジク + 魚」、vaṭa-mīn「北極星」である。画像:Corpus of Indus Seals and Inscriptions, vol. 1 (Joshi and Parpola 1987), p. 100, M-414 a。

03 1994年の読みとタミル語による検証

Parpola の1994年の本は、24の読みの表と、彼が依拠した mīn「魚、星」を含む99のタミル語複合語のリストで締めくくられる。両コーパスで、次の文字の対は実在し、繰り返し現れる単位である。3 + 魚、6 + 魚、目 + 目、炉 + 輪、輪 + 「空間」、「空間」 + 魚。魚 + 魚、7 + 魚、イチジク + 魚、イチジク + 「空間」、蟹 + 無印の魚は、偶然と同程度かそれ以下である。本は、魚の前の数は「are restricted to 3, 4, 6 and 7」と述べる。コーパスには 1、2、3、4、6、7、12 があり、5 は一度もない。タミル語には5に対応する星の名前があるにもかかわらずである。

すべての読みの背後にある検証は、それが与える複合語が実在するタミル語の語であるかどうかである。偶然の基準線を置くと、それがどれほど弱いかがわかる。前もって固定した98の図像概念を取る。その図像を表す何らかのタミル語の語が Parpola のタミル語の星の名前のどれかの語頭になる確率は15%で、読みが用いている音の許容幅を認めると30%になる。

04 銅板:文字 = 図像の7つの等式

モヘンジョダロの銅板は、同一の写しの組になっている。それぞれ片面に銘文、もう片面に動物や人物があり、いくつかの組では図像のかわりに1つの文字が置かれ、銘文は同じである。Parpola による46組の類型を転写と照合すると、7つの等式が得られる。

これらが、この文字体系が与える最も確かな意味である。図像文字 749、341、753 は銅板にしか現れず、777 はそれに加えて1つの印章に現れるだけである。どの印章の名前もこれらを使わない。多くの印章のテキストの冒頭に来る見出しは、銅板のテキストの冒頭には決して来ない(198中0)。銅板は印章とは異なるふるまいをする。9節の捕獲再捕獲テストでは、銅板のテキストはラベルの小さな閉じた集合をなし、称号のように都市中で繰り返されるが、印章のテキストは個別的である。銅板の図像はモヘンジョダロの地区ごとにもまとまっている。テキストだけの銅板は DK-G South に、動物の系列は VS-A に、人物と合成像は城塞の丘にある。

最も多い銅板の銘文と、その数と図像
最も多い銅板の銘文を、書かれたとおり(右から左)に、写しの数、読む順序、裏面の図像とともに示す。ウサギ、射手、象、単独で立つイチジク + 蟹の合字。画像:ICIT 派生のコーパスから、ここで indus-website のフォントにより描画。

05 どの言語か? 対照としてのサンスクリットとシュメール語

同じ検証をサンスクリット(Monier-Williams)とシュメール語(ePSD2 の語彙集)でも行った。図像が星の名前を与えるのは、サンスクリットで19%、シュメール語で10%であり、タミル語は15%である。魚 = 星の語呂合わせもドラヴィダ語だけのものではない。シュメール語の mul は「星」であり、魚でもある。サンスクリットには ṛṣi(魚。大熊座の七賢者)がある。しかし2,895の言語(CLICS4)全体で、「魚」と「星」を表す普通の語が一致するのは3言語だけで、南アジアには一つもなく、古タミル語の mīn がそのうちの1つである。したがって、すべての魚の読みの第一歩は真にドラヴィダ語に特有であるが、その上に築かれたタミル語の複合語による検証はそうではない。魚の前の数はタミル語の星の名前に従わない。有意に多いのは6 + 魚、すなわちプレアデスだけで、5 + 魚は一度も現れない。

06 残りの進め方:検証前に登録した仮説

上の検証以降のすべては、登録された予測として実行した。各組について、仮説とその閾値を targets/indus/PREDICTIONS.md に書き込み、どのスクリプトもデータを見る前にリポジトリにコミットした。その後で検証を実行し、閾値を変えずに結果を成立または失敗として記録した。この方法で247組、2,727の仮説を実行した。1,425が成立し、1,302が失敗した。176組目以降は、固定した進捗指標に対して採点するループとして実行した(targets/indus/PROGRESS.md)。検証の設定が不適切だとわかった場合や、スクリプトにバグがあった場合は、記録にそう書き、元の結果の横に訂正した結果を示している。

数は異なるテキストについて数えている。多くの封泥に押された同じ印章や、同一のタブレットの一群は1回と数える。繰り返された写しはどんなパターンも水増しするからである。主要な結果は、それを見つけるのに使わなかったサンプルで再度検証した。Mahadevan の M77 で追加されたもの、小さな遺跡、銅板を除いたより完全なコーパス、そして Parpola の CISI の転写である。読むことのできる2つの文字体系を対照実験とした。線文字B(ミケーネ・ギリシア語、DAMOS データベースから)と、ウル第3王朝期の印章銘(シュメール語、ORACC からの22,402の押印)である。

07 読みが従うべき文法

08 第二の転写と他者の主張

09 どのような名前か?

印章のテキストは短く、動物の下に置かれ、文法的な枠で終わる。それは個人名なのか、称号や役職なのか、神なのか。捕獲再捕獲法、すなわち生態学者が重なり合う2つの標本から個体数を推定するのに使う方法は、音価なしにこれを問う手段を与える。モヘンジョダロの印章の名前とハラッパーの印章の名前を、1つの母集団からの2回の捕獲とみなす。両方に現れる名前の数が、母集団全体の大きさを教えてくれる。

10 場所と時代

11 語順から見える限りの言語

音価がなければ、言語について語るのは語順と文法の形だけである。4つの特徴が同じ方向を指す。

これはドラヴィダ語とインド・アーリア語に合致し、主要部を前に置くシュメール語とエラム語には不利である。さらに2点が範囲を狭める。語尾は人と魚の名前(Parpola の星)を分けるが、ムンダ語の文法はそうしないだろう。そして魚 = 星の語は、南アジアではドラヴィダ語にしかない。合わせるとドラヴィダ語に傾くが、それは魚の名前が星である場合に限られ、ここには語順だけでドラヴィダ語とインド・アーリア語を区別するものはない。語族についての予想は標準的な類型論であり、言語ごとに確認した典拠ではない。

候補となる言語の名前のリストからは2つの結果が加わる。ウル第3王朝の印章にあるシュメール語の個人名はその最初の要素(Ur-、Lu-、Nin-、神を表す文字)を固定するが、インダスの名前は線文字Bやサンスクリットの名前と同じく最後の要素を固定する。これでシュメール型の名前の構造は再び除外される。ドラヴィダ語とインド・アーリア語の間では、リストは決め手にならない。インダスの名前の長さはサンスクリットの名前に近い。1つの語尾の優勢(740 が名前の82%を締めくくる)は古タミル語の個人名に近く、その67%は男性形の -aṉ で終わる。これは Mahadevan が 740 をそう読む接尾辞である。より近いインド・アーリア語の比較対象が、その後この議論をひっくり返した。Lüders による初期ブラーフミー碑文のリスト(1912年)は、サーンチーとバールフトの、紀元前200年–紀元400年頃の374のプラークリットの寄進者名を挙げている。これらは寄進物に記された個人名で、時代、場所、ジャンルにおいてインダスの印章に近い。インダスの名前はそれらと同じように作られている。

プラークリットの寄進者名にも、ほぼ普遍的な語尾が1つある。寄進の定型句の属格 -sa である。したがって 740 のような優勢な語尾は、タミル語の -aṉ と同様に、インド・アーリア語の寄進者型の定型句にも合う。これに対応するドラヴィダ語の検証には、寄進記録のタミル語の名前を使った。7世紀以降の DHARMA タミル語碑文の英訳から取った1,396の名前である。この検証は証拠を二分する。

したがって、名前の構造はシュメール型を除外するが、インド・アーリア語とドラヴィダ語の間の決め手にはならない。タミル語の記録はプラークリットのリストよりずっと後のもので、その名前の多くはサンスクリット由来でもある。

次に、Mahadevan の Early Tamil Epigraphy のページスキャンから、同時代のドラヴィダ語のリストを作った。紀元前2世紀頃–紀元4世紀頃のタミル・ブラーフミー洞窟碑文から取った104の寄進者名である。これは時代とジャンルにおいてプラークリットのリストに対応する。

これらの尺度では、インダスの名前は同時代のタミル語の名前よりも初期インド・アーリア語の寄進者名に似ているように見えた。後の対照実験がそれを撤回させた。類型を揃えた囮として、インダスの語順の特徴を共有する言語である日本語とトルコ語の個人名を加えた。南アジアの2つの寄進者リストは両方の囮に勝ったが、それらは碑文であり、囮は名前のリストだった。両側でジャンルを揃えると(Monier-Williams のサンスクリット名とサンガム詩人の名前を、同じ日本語とトルコ語のリストと比べると)、データのどちらの半分でも日本語がインダスの名前に最も近くなった。先の傾きはジャンルによるもので、言語によるものではなかった。この種の名前の構造の統計では言語を選ぶことはできない。

世界の類型論は範囲を狭めるが、それ以上ではない。インダスの語順の特徴を WALS と Grambank のデータベースと照合すると、世界の言語の属の81%(Grambank の語族の68%)が除外される。ドラヴィダ語、インド・アーリア語、ムンダ語、ブルシャスキー語、テュルク語、モンゴル語、日本語、朝鮮語はすべて残る。唯一の類の信号(主要部が魚の名前は 520 を取り、主要部が人、道具、植物の名前は 740 を取る)は、モヘンジョダロ、ハラッパー、その他の遺跡で、前期にも後期にも成り立つ。これはドラヴィダ語の人/非人の区別にも、星の名前の大半が女性形であるサンスクリットの性による読みにも、同じように合う。

12 賞金に照らした基準

2025年1月、タミル・ナードゥ州政府は、この文字を「to the satisfaction of archaeological experts」解読した者に100万米ドルを提供すると発表した。それ以上の規則は公表されていない。ここでの作業は、そのような審査団が必要とするであろうものに照らして、重みの順に採点した(targets/indus/PROGRESS.md, prizebench.py):

第1段階と第3段階を引き上げようとする試みから、2つの発見が得られた。タブレットの図像は、型から繰り返されたテキスト全体と結びつくのであって、単一の文字とではない。タブレットの半分で固定した図像の意味は、未見の38枚中1枚しか予測しない。共有された2文字の句には弱い傾向がある(各テキストを順に1つずつ除くと17%で正解、p = 0.05)。その大半は象の句 706 33 923 740 と木の句 806 158 である。タミル・ナードゥ州の落書き記号(Rajan and Sivanantham 2026, vol. II)を、文字の等式を必要としない検定でインダスの行と比較した。2つの落書きの要素が一緒に現れる場合、それらが同じ順序を保つのは70.5%で、インダス文字では88.0%である。この数字は Keeladi でも Thulukarpatti でも同じである。記録されている限り、落書きの組み合わせはインダスの書記より秩序が弱い。

同じループから、構造上の追加が2つ得られた。計数の直前の枠は、両コーパスで、限られた集合、すなわち計数のためのラベルで埋められる。最も多い10の文字がこの枠の52%と58%を占め、シャッフルした行よりはるかに多い。一部は見出しだが、それだけではない。そしてこの規則を加えた文法は、未見の行をシャッフルした行よりもわずかに大きな差でうまく解析する。

最も強い補助的結果は整合性である。学習した部分を含めて文法をある場所の行に当てはめ、別の場所で、シャッフルした行に対する差として採点する。

字形の工夫、計数ラベルの枠、魚/520 の類の信号は、どの都市でも、印章でもタブレットでも同じようにふるまう。籠で囲まれた文字は決して 740 も 520 も取らず、線の入った壺が行を終えることはほとんどない。1つの文法体系がインダス世界全体で用いられていたので、どんな読みもあらゆる場所でそれに合わなければならない。名前に接頭辞が見られないことから、言語に接頭辞がないことを条件にすると、類型はさらに絞られる。WALS の属の85%、Grambank の語族の77%が除外される。

この基準で勝つものは何か。70ほどのよく使われる文字に値を与え、大半のトークンを1つの言語の文法的な句として読むこと。その意味は、数種類の外部の証拠と一致しなければならない。方法は線文字Bの対照実験に合格し、値を決めるのに一度も使われなかったテキストを読み、それを作っていない専門家によって再現されなければならない。本研究は、そのような主張が合格すべき文法と検証を提供する。読みは何一つ提供していない。

13 未解決のまま残る点

14 途中で撤回したこと

予測を先に登録するということは、本プロジェクト自身の読みのいくつかが後の検証によって覆されたということである。それらは記録に残し、ここに挙げる。

15 出典

スクリプト、登録した仮説(PREDICTIONS.md)、各組の結果(results/)、作業ノート(NOTES.md)は、リポジトリのフォルダ targets/indus/ にある。