Bible Network Crypto DeFi Onchain RWA AI Agent Stablecoin Chain SAFU CryptoTax DeFAI AGI Claude Me Claude Skill Claude Design Claude Cowork
独立メディア
いかなるプロジェクトとも無提携
汎用人工知能、理論から現実まで完全解説
agi-bible.com
最新
FLI 2026年夏季AI安全指数発表:9社中トップ合格なし、首位Anthropicも評価はC+のみ
news

FLI 2026年夏季AI安全指数発表:9社中トップ合格なし、首位Anthropicも評価はC+のみ

30秒バージョン · 忙しい方へ
AI企業9社、安全性評価で合格ゼロ——パネルの結論:これは能力の遅れではなく、公約の後退である。

詳しく読む +
01 · なぜ起きたのか?

この指数の採点方法は信頼できるのか、それとも単なる主観的な印象による評価なのか?

採点は、AI整合性、ガバナンス、解釈可能性など異なる専門分野を持つ7名の独立研究者からなるパネルによって行われた。評価は、公開されているモデルカード、研究論文、ベンチマーク結果に基づき、さらに各社に対する専項アンケート調査を組み合わせている。これは、業界の開示不足による透明性のギャップ(内部告発者保護制度や外部モデル評価の詳細など)を補うことを目的としている。各領域の評価は米国のGPA制度に基づく絶対基準(A/B/C/D/FがそれぞれA4.0〜0に対応)を用いており、各評価者個別の採点は匿名で保持され、最終スコアは複数評価者の平均値であり、単一人物の主観的判断ではない。

ただし、この指数のデータ収集は2026年6月3日で締め切られており、それ以降に発生した可能性のある新たな出来事は含まれていない点は、スコアを解釈する上で留意すべき時間的な制約である。

02 · 仕組みは?

9社すべてが評価対象となったが、中国企業の評価基準は米欧企業と同じなのか?

報告書は中国の規制環境の特殊性について独立した章を設けて説明している。中国の国家レベルの拘束力を持つ規制(サイバーセキュリティ法、生成AIサービス管理暫定弁法など)は直接的な法的効力を持ち、違反すれば最大5000万人民元または世界売上高の5%の罰金が科される可能性がある。一方、米国企業に一般的な「自主的公約」は、中国の文脈ではまだ正式発効していない推奨性標準や地方の促進条例に相当することが多く、国家レベルの強制規制よりも拘束力がはるかに低い。

これは、中国企業(DeepSeek、Alibaba Cloud、Z.ai)が自主的安全公約などの指標で低評価を受けていることが、ある程度、規制経路の構造的違いを反映しているのであり、必ずしも「安全性を軽視している」ことと同義ではないことを意味する。パネルの個別企業への提言でも、これらの企業の評価は「独立した安全性リーダーシップというより、主に中国の規制環境を反映している」と述べられており、言い換えれば、低評価自体もまだ各社の実際の安全実践レベルを十分に反映していない。

03 · 自分にどう影響する?

どの企業もスコアが高くない場合、この指数は業界に実際に影響を与えているのか?

過去の推移を見ると、これはFLIが2024年以来発表している3回目の同様の指数であり、過去の評価変化を見ると、一部の企業は評価結果を受けて実際に対応を調整していることがわかる。例えば今回、Metaは前回の6位から4位に上昇した一方、xAIは4位から7位に後退した。これは、この指数が現時点では企業の行動を直接強制できる規制ツールというより、「持続的な外部圧力をかける」仕組みとしてより機能していることを示唆している。

パネルは報告書の中で構造的な限界も指摘している。複数の企業が最近安全フレームワークを発表または更新しているが、フレームワーク自体が「量的な閾値、真に独立した監査、明確な意思決定権限を欠いている場合がある」という点である。言い換えれば、企業が対外的に安全フレームワークを公表する動きが増えても、これらのフレームワークの多くは現時点で「実施しているように見えるが実質的な拘束力を欠いている」状態にある。これこそが、FLIのような第三者評価が存在し続ける意義である——少なくとも、外部から比較可能で、トレンドを追跡できる基準点を提供しているからだ。

04 · どうすればいい?

Anthropicが全体最高スコアを獲得したということは、安全性の問題が最も少ないということなのか?

相対的に高いスコアを獲得したからといって、問題がないわけではない。パネルによるAnthropicへの個別提言には、「RSP 3.0における一時停止公約の後退を撤回し、公約の信頼性を回復する」必要があると明記されている。つまり、首位企業であっても、同じ「ゴールポストの移動」問題についてパネルから指摘を受けているということだ。さらにパネルは、Anthropicに対して「予防を解釈可能性・検出と同じくらい重視すべき」とも提言しており、現在の安全戦略が事前予防よりも事後検出に過度に依存している可能性を示唆している。

より妥当な解釈は次の通りである。Anthropicの相対的な優位性は、主に透明性の開示、リスク評価の幅広さ、ガバナンス構造の完成度といった、比較的達成しやすい指標での高いパフォーマンスに由来している。しかし業界全体で最も弱い領域である「存在的安全性」では、AnthropicもわずかD+にとどまっており、他社と同様、根本的な問題を実際には解決できていない。

全文 +

非営利団体Future of Life Institute(FLI)は2026年7月、最新の《AI Safety Index》を発表した。7名の独立した研究者・ガバナンス専門家からなる評価パネルが、主要AI企業9社を37の指標・6つの領域にわたって採点した。結果は、AまたはBの評価を得た企業はゼロ。Anthropicが総合スコア2.66(C+)で首位となり、OpenAI(C、2.28)、Google DeepMind(C、2.01)が僅差で続いた一方、xAI、DeepSeek、Mistralの3社は不合格(F)評価を受けた。

2024年の初回発表以来、この指数は業界で最も注目される第三者安全評価の一つとなっており、今回の結果もニューヨーク・タイムズ、フィナンシャル・タイムズ、TIMEなど主要メディアで広く引用された。

評価パネルの見解:能力の遅れではなく、公約の後退

単純なスコアランキング以上に注目すべきは、パネルが報告書で直接指摘した傾向である。Anthropic、OpenAI、Google DeepMind、Metaという、これまで安全実践において比較的先進的とみなされてきた4社が、能力の危険水域に近づいた際に一方的に開発を停止するという以前の公約を弱めるか撤回する動きが観察されており、一部の企業は「競合他社が追随するか」といった条件付きの留保を付け加えている。パネルはこの現象を「ゴールポストの移動」と呼び、報告書には「これが業界全体の安全フレームワークを損なっている」と明記している。

カリフォルニア大学バークレー校のStuart Russell教授のコメントは、本指数で最も鋭い一言とされている。各社は以前、「能力レベルに見合った安全対策が整った場合にのみ新システムを発表する」と約束していたが、現在の実際の動向は「明らかに安全でなくても、そのまま発表する予定」に変わっていると指摘した。

存在的安全性は業界全体で最も弱い領域

6つの評価領域のうち、「存在的安全性(Existential Safety)」は9社全てで最も評価が低かった項目である——C-以上を獲得した企業は1社もなく、大半がDかそれ以下だった。パネルは特に、Anthropicのconstitutional classifiers、OpenAIのガバナンス機関設立の呼びかけ、Google DeepMindの監視公約、Metaの制御喪失防止条項について、いずれも実質的な取り組みであると認めながらも「完全に不十分」(entirely inadequate)と評した。報告書はまた、業界が主に依存する解釈可能性や思考連鎖(Chain-of-Thought)監視という手法についても、「検出は予防ではない」として疑問を呈している。

モントリオール大学助教のDavid Krueger氏のコメントも同様に率直だった。AI企業が信頼できる安全計画に向けた進展を見せていないことは「嘆かわしい」とし、企業自身も再帰的自己改善へと向かい、制御を失う可能性に不安を感じ始めていると指摘した上で、CEOたちの最近の協調的一時停止や減速に向けた身振りは歓迎すべきものではあるが、リスクがどれほど切迫しているか、業界がどれほど準備不足であるかを世間に明確に伝えられていないと述べた。

地域分布:EUの規制は先進的だが、代表企業は最下位

報告書は興味深い乖離を指摘している。EUはAI安全規制の立法において世界的に先進的とみなされているが、欧州を代表するAI企業であるMistralは、今回の評価で9社中最下位となった。安全フレームワーク、存在的安全性戦略、ガバナンスの開示は軒並みゼロかそれに近い水準だった。パネルの提言は率直である。Mistralは「存在的安全性に実質的に取り組む」必要があるとし、現在の経営陣は「フロンティアリスクを一貫して軽視し、時には否定している」にもかかわらず、識別可能な制御戦略や整合戦略を一切示していないと指摘した。

F評価を受けた3社はそれぞれ米国(xAI)、中国(DeepSeek)、欧州(Mistral)から出ており、パネルの主要な発見では、安全実践の不足は「特定地域の問題ではなく、世界的な問題である」と明確に強調されている。

軍事応用が新たな懸念として浮上

報告書は今回初めて、「業界の軍事用途への転換」を注視すべき現行の危害リスクとして挙げた。パネルは、2024年から2026年にかけて、以前は軍事応用を明確に禁止していたAnthropic、OpenAI、Google DeepMind、Metaを含む企業が、徐々に方針を転換し、積極的に防衛分野との提携を模索するようになったと観察している。これは、もともと軍事用途を制限していなかったxAIやMistralと実質的に同じ立場に立つことを意味する。報告書はまた、Anthropicが「問題のある軍事関与」についてパネルから批判を受けたことにも言及しており、その中には、多数の民間人死者を出した学校襲撃事件との関連が報じられた提携も含まれる。中国のAlibaba CloudとZ.aiは、米国側から軍事的関連性についての指摘を受けているが、両社ともこれを否定している。

あなたのお金にとって何を意味するか

AI業界を注視する投資家や実務者にとって、この指数は各社自身の安全性に関する主張を超えた較正の基準を提供する。ある企業が「安全性を重視している」と公に強調することと、37の具体的指標における実際の評価結果との間のギャップこそ、パネルが「安全性に関するレトリックが実際の行動を上回っている」(safety rhetoric outpaces revealed behavior)と呼ぶ現象そのものである。報告書は特に、Google DeepMind、OpenAI、xAIの3社について、公の発言と実際の商業行動や立法ロビー活動の立場との間に明確な乖離があると名指ししている。言い換えれば、表明された安全公約そのものは、現時点で企業の実際のリスク管理能力を判断する信頼できる指標にはまだなり得ない——これこそが、こうした独立した第三者評価が業界全体の透明性にとって特に重要である理由である。

質問する
10文字以上入力してください
関連ニュース
関連トピック