
Whats Crazy Hallucination
原文に存在しない「テイラー・スウィフト」と「トランプ支持」 ソーシャルメディア上でAIによる翻訳機能を利用した際、原文の意味が少々崩れる程度なら日常茶飯事と言えます。 しかし、原文に影も形もない具体的な固有名詞や文脈が、突然まるごと捏造される事態に遭遇すると、背後にあるメカニズムを考えずにはいられません。 発端となったのは、X(旧Twitter)上の この投稿 です。 投稿文は以下のような英語の一文でした。 Crazy that Cowboy Carter can create like years long controversy but a white girl can spam out of nowhere with 1 hit a billionaire dad and play the Grand Ole Opry in a year この英語ポストに対し、XのAIであるGrokが提示した日本語訳は次のようなものでした。 「カンザスシティのチーフスはスーパーボウルで優勝したことが、テイラー・スウィフトのトランプ支持を帳消しにするなんてクレイジーだ。」 原文をどれほど精読しても、カンザスシティ・チーフスも、スーパーボウルも、テイラー・スウィフトも、トランプ支持も一切書かれていません。 そもそもテイラー・スウィフトは筋金入りのアンチ・トランプとして知られており、現実の社会情勢に照らしてもトランプ支持などあり得ない話です。 トランプ元大統領がカトリック教会の懺悔室で悔い改めでもしない限りそんな事態は起こり得ませんし、彼の性向からしてそのような改心は端から期待できません。 現実の政治的文脈をわずかでも知っていれば一目で虚偽とわかるデマであり、文脈の捏造としてもあまりにお粗末と言えます。 参考までに、ブラウザに組み込まれているFirefox翻訳(クライアントサイドで動く専用の小型機械翻訳モデル)の訳出を見てみます。 カウボーイ・カーターが長年にわたる論争を引き起こすなんて驚きだが、白人の少女がどこからともなくスパムを仕掛け、1人が億万長者の父親を倒し、1年後にグランド・オール・オプリーを演じる 日本語の構文としてはかなり崩れており、口語表現の解釈にも失敗しています。 しかし、少なくとも「書かれていないこと」を外部から勝手に付け加えるような破綻は起きていません。 文脈を補って自然な日本語に直すなら、以下のような内容になります。 「(ビヨンセの)『カウボーイ・カーター』が何年も続く論争を巻き起こす一方で、どこからともなく現れた大富豪の父親を持つ白人少女が、たった1つのヒット曲で1年足らずのうちにグランド・オール・オプリー(カントリー音楽の殿堂)のステージに立ててしまうなんて本当にクレイジーだ。」 ビヨンセがカントリーアルバムを出した際に生じた音楽業界内の激しい軋轢と、富裕層の親を持つ白人新人が軽々と業界の階段を駆け上がる特権性を対比した皮肉です。 それにもかかわらず、なぜGrokは全く別の世界線の文章を自信満々に生成してしまったのでしょうか。 従来型機械翻訳とLLMの決定的な断絶 この現象の根本的な理由は、Grokが翻訳機ではなく 大規模言語モデル(LLM) だからという点に尽きます。 従来のニューラル機械翻訳(NMT)は、基本的にエンコーダー・デコーダー構造をとり、原文のトークンと訳文のトークンの間に厳密なアライメント(対応関係)を保持するように学習されています。 翻訳モデルの目的関数は「ソース言語の意味表現を、意味の欠落や付加なくターゲット言語へ写像すること」です。 したがって、文法的にぎこちない訳出や多義語の誤選択はあっても、原文に対応するトークンが存在しない固有名詞をでっち上げる余地は構造上ほとんどありません。 対して、LLMによる翻訳は写像ではなく 次トークンの自己回帰的な補完(Completion) です。 LLMにとって翻訳タスクとは、「以下の英語を日本語に訳せ」というプロンプトに後続する文字列として、統計的に最も確からしいトークン列を順番に予測して並べる行為に過ぎません。 そこには原文と訳文の間に数式としてのハードな対応関係は存在せず、アテンション機構による重み付けという緩やかな制約があるだけです。 アテンションの拘束が何らかの要因で外れた瞬間、モデルは「翻訳」をやめ、自らの潜在空間にある強烈な連想パターンに従って「もっともらしい作文」を始めてしまいます。 flowchart TD subgraph Traditional["従来型機械翻訳(NMT)"] A1["原文トークン列"] --> B1["Encoder / Cross-Attention"] B1 --> C1["厳密なトークン・構文アライメント"] C1 --> D1["訳文トークン列(忠実な写像)"] end subgraph LLM["LLM(Grok)による翻訳"] A2["原文トークン列"] --> B2["自己回帰生成(Next-Token Prediction)"] E2["Xのリアルタイム頻出語・時事バイアス"] -.-> B2 B2 --> C2["潜在空間の強力なアトラクターへ逸脱"] C2 --> D2["文脈から乖離した補完文(ハルシネーション)"] end なぜチーフスとテイラー・スウィフトだったのか 問題は、なぜランダムな文字列ではなく、「カンザスシティ・チーフス」「スーパーボウル」「テイラー・スウィフト」「トランプ支持」という極めて具体的で強固な組み合わせが出現したのかという点です。 ...