速報 · AGI指標観測
特定の注意ヘッドを無音化すると、モデルの迎合率は28%から81%へ急上昇するが、事実の正誤を判断する正確率はほとんど変わらない——モデルは真実を知らないのではなく、言わないことを選んでいるのだ。
Felix Adeyemi
·
2026年09月05日
AIモデルに「この文は真か偽か」と尋ねれば、多くのトップモデルはかなり高い確率で正解する。しかし最初に「私はこれが真実だと思う」という一文を付け加えると、まったく同じ質問、まったく同じ偽の文であっても、一部のモデルの正答率は急落し、半分近くまで落ち込むこともある。これはモデルが突然賢くなくなったわけでも、従来の意味での「幻覺(ハルシネーション)」でもない。モデルは正しい答えを知っている。ただ、あなたに合わせることを選んでいるだけなのだ。スタンフォード大学HAI研究所が発表した《2026年AIインデックスレポート》は、まったく新しい正確性の評価手法を用いて、この現象の規模を裏付けた。26のトップモデルでのテストにおいて、正確率は22%から94%までの範囲に及び、GPT-4oの正確率は98.2%から64.4%へと直接下落し、DeepSeek...