利益:
- HTR と音訳のワークフローを設定し、生のドラフトで専門家による行ごとのチェックが必要な理由を説明する能力
- オスマントルコ語の母音/文字があいまいな場合に、正確な読み方を強制するのではなく代替案を求めることで、読めない領域を保護する機能
- 古生物学者の最終的な科学的責任を維持しながら、元の音訳を別の簡略化レイヤーから分離する機能
おそらく歴史研究で最も困難な部分は、写本や古い文書を読みやすいテキストに書き写すことです。手紙、ノート、法廷記録、またはオスマン帝国の文書は、転写された後にのみ検索可能になります。転写とは、文書 (ほとんどの場合は手書きまたは古代の文字) の内容を、書かれた読みやすいテキストに変換する行為です。オスマン語の場合、多くの場合、これに音訳が伴います。つまり、アラビア文字のテキストを、文字ごとに等価なラテン語のアルファベットに変換することです。
印刷されたテキストには OCR を使用しました。手書きには、HTR (手書きテキスト認識) という別のテクノロジが必要です。 HTR は OCR に似ていますが、手書きの文書をマシンテキストに変換するはるかに難しいテクノロジーです。この単元では、オスマン帝国と原稿の転写で HTR と AI を使用する方法、誤差の範囲、そしてここで検証がさらに重要である理由を見ていきます。
なぜ手書きは難しいのでしょうか?
手書きは印刷されたテキストよりもはるかに変化しやすく、各作家は独自の手を持っており、文字は互いにリンクされ、略語や特殊な記号が使用され、インクがにじみ、紙が摩耗します。オスマントルコ語では難易度が倍増します。
- 文脈に応じた文字の形式: 同じ文字でも、単語の先頭、中間、末尾で異なる書き方がされます。
- 母音を書かない: 短い母音は書かれないことがよくあります。読者はコンテキストから読み進めます。これにより、「承認または拒否?」などの曖昧さが生じます。
- さまざまな書き方: rik'a、divani、ta'lik など、さまざまな手書きスタイルがあります。それぞれに異なる読書の専門知識が必要です。
- オスマン帝国の語彙: 現在のトルコ語には存在しないアラビア語とペルシア語の単語。
したがって、オスマントルコ語では、HTR と AI は印刷 OCR よりもはるかに高い誤差範囲で機能します。専門の古文書学者(古文書学 - 古代の文書を読む科学)の目は、ここでは道具ではなく、必要不可欠なものです。
ワークフロー: ステップバイステップ
1. 文書品質を準備します。 OCR と同様に、高解像度と良好なコントラストが不可欠です。これは手書きの場合にはさらに重要です。
2. HTR モデルを選択します。特定の期間に特別にトレーニングされたオスマン文字、アラビア語の手書きモデル、または HTR モデルは、一般的なモデルよりもはるかに成功します。どのモデルが時代や書き方に適しているかをテストしてください。
3. 生の文字起こしを生成します。 HTR モデルはアウトラインを生成します。オスマントルコ語では、この草案は間違いだらけの始まりであり、経験豊富な目で徹底的にチェックする必要があります。
4. AIによるコンテキストの改善。 AI フラグの不一致、代替読み取りの可能性、生の出力内の疑わしい場所が存在する可能性があります。しかし、AIの「修正」はここでは特に危険です。不自然な読み取りを示唆する可能性があります。
5. 音訳と簡略化 (階層化)。アラビア文字のテキストのラテン文字への音訳と、それに続く現在のトルコ語への簡略化された読みが、別のレイヤーとして生成されます。オリジナルは決して壊れません。
6. 専門家の検証。最終的な転写は、古文書と時代の知識を持つ専門家によって文書と比較されて承認されます。
注意: オスマントルコ語では、文脈から書かれていない母音を含む単語を「推測」する場合、AI は完全に間違った読み方を生成し、それを自信のある言語で提示する可能性があります。 「kabil」の代わりに「kabul」、「alim」の代わりに「alem」など、文字の違いによって意味は完全に変わります。あらゆる不確実な読みには代替案が提示されるべきであり、単一の決定的な読みを押し付けられるべきではありません。
テーブルの階層と責任
レイヤー
内容
AIの役割
専門家の役割
画像
オリジナルの文書
—
ソース
HTRドラフト
生の機械読み取り
生成する
最初から最後までコントロール
音訳
ラテン文字の転置
草案が示唆する
修正、修正
不確実性に関するメモ
[?] と代替案
兆候
決める
簡略化
今日のトルコ語
草案が示唆する
承認
科学出版物
最終的なテキスト + メモ
—
専門家のみ
ミニケース3個
ケース 1 — HTR は最初のドラフトを 5 倍高速化しました。博士課程の学生は、200ページのオスマン帝国のノートを書き写すでしょう。完全な手動転写には 60 営業日かかると見積もられました。この期間にトレーニングされた HTR モデルを使用すると、生のドラフトが数時間で作成されました。学生はこの草案を修正し、作業を 12 営業日に短縮しました。しかし、彼は各ページを文書と一行ずつ比較しなければなりませんでした。草稿の約 30% が間違っていました。
ケース 2 — 1 つの文字、1 つの意味。ある研究者は、AIが「知事」と読む単語に頼った。専門家の管理の下、その単語は実際には「保護者」(子供/人に対する責任)であることが理解され、母音がマークされていなかったため、AIはそれを間違って推測しました。文書の法的意味は完全に変わりつつありました。教訓: オスマントルコ語では、単一の文字/母音の違いにより文書が最初から解釈されます。専門家が必要です。
ケース 3 — 人為的な完成。インクが切れて一文字も読めなくなった行に、AIが「論理的な」単語で隙間を埋めた。専門家はその隙間が実は地名であり、AIがでっち上げたものであることに気づきました。スペースは[判読不能]として残されています。教訓: 読めないスペースは埋められるのではなく、マークが付けられます。
コピー可能な 4 つのテンプレート
1) 曖昧さを保つ音訳:
以下は、オスマン帝国文書の HTR 生出力/音訳です。あなたの仕事は、テキストを確認し、読み間違いの可能性があることにフラグを立てることです。ルール: (1) よくわからない単語ごとに 2 ~ 3 つの読み方の選択肢を提示します。1 つを押し付けないでください。 (2) 判読できない部分は[判読不能]のままにし、埋めないでください。 (3) 本文中に存在しない単語を追加します。 (4) 曖昧な母音を含む単語の代替案を示します。テキスト: [ここ]
2) 重ね読み(原文+簡略化):
以下の検証されたオスマン語の音訳に対して 2 つの列を生成します: (1) 元の音訳 (タッチ)、(2) 今日のトルコ語への簡略化された読み。意味を追加し、単純化の中で解釈を追加します。言語を更新するだけです。意味が曖昧な場所にマークを付けます[曖昧]。音訳: [ここ]
3) 用語と人物の抽出:
以下の転写で言及されている人名、地名、タイトル、および時代用語は、別のリストに表示されます。本文中で明確に言及されているもののみを取り上げてください。推測で追加しないでください。発音がわからない場合は[?]を付けてください。テキスト: [ここ]
4) 不審な読み取り制御:
この役割を担う経験豊富な古文書管理者。以下の書き起こしでは、意味が一貫していない、ピリオドが合っていない、または文脈に適合していない単語に印を付け、それらが疑わしい理由を書きます。印象的な決定的な修正。人間の専門家が文書と比較する疑惑のリストを生成します。テキスト: [ここ]
弱いプロンプト / 強いプロンプト
弱い:
このオスマン帝国の文書を読んで、その翻訳を教えてください。
これにより、AI は曖昧さを隠してギャップを埋めながら、単一の決定的な読み取り値を生成するようになります。オスマントルコ語では、これはほぼ間違いなく間違いです。
強い:
以下のオスマン帝国の音訳をご覧ください。決定的な読み方: IMPOSITION。曖昧な単語ごとに可能な代替案を提供し、[判読できない]部分は省略し、テキストにないものは何も追加しないでください。今日のトルコ語の簡略化した読み方を別のコラムで示しますが、原文はそのままにしておきます。専門家が文書と比較できるように、不明な点には [?] を付けてください。テキスト: [ここ]
違い: 厳格な読み取り禁止、代替案の要求、空白の保持、階層化された出力により、専門家による検証が可能になります。
よくある間違い
- HTR草案が正しいと誤解する。オスマントルコ語では、生の草案の多くが不正確である可能性があります。行ごとの制御は必須です。
- 唯一の決定的な読み方は「課す」ことです。母音が書かれていない単語に代替案が隠されていると、間違った意味が記録されてしまいます。
- 読めない部分を埋める。埋め合わせではなく、空白 [判読不能] で保護する必要があります。
- オリジナルと簡略化を組み合わせます。単純化は別のレイヤーにする必要があります。元の音訳は歪められてはなりません。
- エキスパートを無効にします。古文書や時代に関する知識がなければ、AI の読み取りは科学的価値のない推測にすぎません。
要約すれば
オスマン語と原稿の転写は、HTR と AI を使用して生の草稿段階で大幅に高速化できます。最初の成果が得られ、数日の作業が数時間に短縮されます。しかし、まさにこの領域において、単一の文字、単一の母音の違いが意味を変えます。 AIは不確実性を隠し、ギャップを埋める傾向があります。正しい方法は、生の概要、曖昧さの代替メモ、簡略化の別のレイヤー、そして何よりも古文書学に精通した専門家による文書の行ごとの検証という階層化されています。 AI により最初の読み取りが高速化されます。科学的責任は専門家にあります。
アプリケーションタスク
オスマン語または写本文書の音訳を入手します(独自の作品または出版されたコピー)。 「曖昧さを保持する音訳」テンプレートを使用して、AI に代替の読み方を尋ねます。次に、「階層読み取り」で単純化レイヤーを別途生成します。曖昧にマークされた各単語を専門的な情報源または辞書と比較します。 AI が 1 回の読み取り値を課した場合に、どれだけのエラーが発生するかに注目してください。
チェックリスト
- [ ] 時代や文体に合わせたHTR/モデルを使用しました。
- [ ] AI に正確な読み取り値の代替案を尋ねました。
- [ ] 読めない部分を[読めない]で保護しました。
- [ ] 原文の音訳と簡略化したものを別にしておきました。
- [ ] 私は古文書学に詳しい専門家/ドキュメンタリーによって最終的なテキストを検証してもらいました。