Bible Network Crypto DeFi Onchain RWA AI Agent Stablecoin Chain SAFU CryptoTax DeFAI AGI Claude Me Claude Skill Claude Design Claude Cowork
獨立知識媒體
與任何項目無關聯
通用人工智慧,從理論到現實的全解析
agi-bible.com
最新
FLI 2026 夏季 AI 安全指數出爐:九大實驗室無一及格,Anthropic 居冠也只拿 C+
news

FLI 2026 夏季 AI 安全指數出爐:九大實驗室無一及格,Anthropic 居冠也只拿 C+

30 秒速讀
九家 AI 實驗室,沒有一家安全評分及格——評審團說得最重:這不是能力落後,是承諾在倒退。

完整解析 +
01 · 為什麼發生?

這份指數的評分方式可信嗎,會不會只是主觀印象打分?

評分由七位獨立學者組成的評審團進行,涵蓋 AI 對齊、governance、可解釋性等不同專業背景,評分依據是公開可查的模型卡、研究論文、基準測試結果,加上針對各公司發出的專項問卷調查,用意是補上產業揭露不足的透明度缺口(例如吹哨者保護機制、外部模型評測細節)。每個領域的評分採用美國 GPA 制的絕對標準(A/B/C/D/F 對應 4.0–0),評審給出的個別評分保持匿名,最終分數是多位評審平均後的結果,並非單一人的主觀判斷。

不過這份指數的資料蒐集截止於 2026 年 6 月 3 日,不包含之後可能發生的新事件,這是解讀分數時需要注意的時間侷限。

02 · 運作原理是什麼?

九家公司都被評分,中國企業的評分標準跟美歐公司一樣嗎?

報告特別以獨立章節說明中國監理環境的特殊性:中國的國家級強制性法規(如網路安全法、生成式 AI 服務管理暫行辦法)具有直接法律效力,違反可面臨最高 5000 萬人民幣或全球營收 5% 的罰款;相對地,美國企業常見的「自願性承諾」在中國語境下對應的多半是尚未正式生效的推薦性標準或地方性促進條例,約束力遠低於國家級強制法規。

這代表中國企業(DeepSeek、Alibaba Cloud、Z.ai)在「自願性安全承諾」這類指標上的低分,某種程度上反映的是監理路徑的結構性差異,而不完全等同於「不重視安全」——評審團在個別公司建議裡也提到,這幾家公司的評分「主要反映的是中國監理環境,而不是獨立的安全領導力」,換句話說,低分本身也還沒充分反映公司真正的安全實踐水準。

03 · 如何應用

如果每家公司分數都不高,這份指數對產業實際上有推動作用嗎?

從歷史軌跡看,這是 FLI 自 2024 年以來第三次發布類似指數,過去幾期的評分變化顯示部分公司確實會因評分結果調整作法——例如本次 Meta 從上一期第 6 名進步到第 4 名,但同時 xAI 從第 4 名退步到第 7 名,顯示這份指數目前比較像是「持續施加外部壓力」的機制,而非能直接強制企業改變行為的監理工具。

評審團在報告裡也點出一個結構性侷限:多家公司近期發布或更新了安全框架,但框架本身「缺乏量化門檻、真正獨立的稽核,以及清楚的決策權責」,換句話說,即使企業對外釋出安全框架的動作變多,這些框架目前多數仍然「看起來有做但缺乏實際約束力」,這也是為什麼像 FLI 這樣的第三方評比持續存在的意義——它至少提供了一個外部可比較、可追蹤趨勢的基準點。

04 · 我該怎麼做?

Anthropic 拿到全場最高分,是不是代表它的安全問題最少?

拿到相對最高分不等於沒有問題。評審團在 Anthropic 的個別建議裡明確寫著,Anthropic 需要「撤回 RSP 3.0 對暫停承諾的退讓,恢復承諾的可信度」,也就是說,就連排名第一的公司,也被評審團點名有「移動球門柱」的問題。此外,評審團同樣建議 Anthropic「把預防看得跟可解釋性╱偵測一樣重要」,暗示目前的安全策略可能過度依賴事後偵測,而非事前預防。

比較合理的解讀是:Anthropic 的相對優勢,主要來自於在揭露透明度、風險評估廣度、治理架構完整度這幾項「相對容易做到」的指標上表現較好,但在「存在性安全」這個全產業最弱的領域,Anthropic 也只拿到 D+,跟其他公司一樣,還沒有真正解決根本問題。

完整內容 +

非營利組織 Future of Life Institute(FLI)於 2026 年 7 月發布最新一期《AI Safety Index》,由七位獨立學者與治理專家組成的評審團,針對九家主要 AI 公司在 37 項指標、六大領域的安全實踐進行評分。結果顯示:沒有一家公司拿到 A 或 B 等級,Anthropic 以總分 2.66(C+)排名第一,OpenAI(C,2.28)與 Google DeepMind(C,2.01)緊追在後,xAI、DeepSeek、Mistral 三家則直接被評為不及格(F)。

這份指數自 2024 年首度發布以來,已成為業界最受媒體關注的第三方安全評比之一,本次結果被《紐約時報》《金融時報》《TIME》等主流媒體大量引用報導。

評審團怎麼看:不是能力落後,是承諾在倒退

比起單純的分數排名,評審團在報告中點出的趨勢更值得注意:Anthropic、OpenAI、Google DeepMind 與 Meta 這四家過去被視為安全實踐相對領先的公司,近期都被觀察到「弱化或撤回」先前對於接近能力紅線時單方面暫停開發的承諾,部分公司甚至附加了「其他競爭對手是否跟進」這類條件式但書。評審團將這個現象稱為「移動球門柱」(moving goalpost),並在報告中直接寫道,這種做法已經「全面削弱了整個產業的安全框架」。

加州大學柏克萊分校教授 Stuart Russell 在報告中的評論被視為本次指數最尖銳的一句話:他指出,各家公司過去承諾「只在安全措施跟得上能力等級時才發布新系統」,但現在的實際走向,已經變成「即使明顯不安全,也打算照樣發布」。

存在性安全是全產業最弱的一環

六大評分領域中,「存在性安全」(Existential Safety)是全部九家公司表現最差的項目——沒有任何一家拿到 C- 以上,多數落在 D 或更低。評審團在報告中特別點名,Anthropic 的 constitutional classifiers、OpenAI 呼籲建立治理機構、Google DeepMind 的監控承諾、Meta 的失控防範條款,雖然都是實質的嘗試,但評審團給出的評語是「完全不足」(entirely inadequate)。報告也質疑目前業界主流依賴的「可解釋性」與「思維鏈監控」(Chain-of-Thought monitorability)路線,認為「偵測不等於預防」。

蒙特婁大學助理教授 David Krueger 的評論同樣直接:他表示 AI 公司在建立可信安全計畫上的進度「令人遺憾」,甚至指出這些公司自己也開始對「邁向遞迴自我改進、可能失去控制」這件事感到不安,但 CEO 們近期釋出的協調暫停或放緩訊號,仍未讓外界清楚知道風險有多急迫、產業準備有多不足。

地區分布:歐盟監理領先,但歐洲代表企業墊底

報告特別點出一個值得玩味的落差:歐盟在 AI 安全監理立法上被普遍視為全球領先,但歐洲最具代表性的 AI 公司 Mistral,在本次評比中卻是九家公司裡分數最低者,安全框架、存在性安全策略、governance 揭露全面掛零或接近掛零。評審團的建議直白地寫著:Mistral 需要「實質投入存在性安全」,因為目前公司領導層「持續淡化甚至否定前沿風險」,卻沒有提出任何可辨識的控制或對齊策略。

三家拿下 F 的公司分別來自美國(xAI)、中國(DeepSeek)與歐洲(Mistral),評審團在關鍵發現中特別強調:安全實踐不足是「全球性問題,不是特定地區的問題」。

軍事應用成為新興隱憂

報告首度將「產業轉向軍事用途」列為值得關注的當前危害風險。評審團觀察到,2024 到 2026 年間,包括 Anthropic、OpenAI、Google DeepMind、Meta 在內、原本明文禁止軍事應用的公司,陸續逐步鬆綁立場,轉為積極尋求國防合作案,實質上已與原本就開放軍事應用的 xAI、Mistral 站在同一陣線。報告也提及 Anthropic 因「有爭議的軍事合作案」遭到評審團批評,其中包含一起被指與造成大規模平民死亡的學校襲擊事件有關聯的合作案。中國兩家公司 Alibaba Cloud 與 Z.ai 則面臨美方對其軍事關聯性的指控,兩家公司均否認。

這跟你的錢有什麼關係

對於關注 AI 產業的投資人或從業者而言,這份指數提供了一個原始宣稱之外的校準基準:一家公司在公開場合強調自己「重視安全」,跟它在 37 項具體指標上的實際評分表現,兩者之間的落差正是評審團特別點名的「安全話術跑在實際行為前面」(safety rhetoric outpaces revealed behavior)現象,報告點名 Google DeepMind、OpenAI、xAI 三家的公開發言與其商業行為、立法遊說立場之間存在明顯落差。換句話說,安全承諾本身,目前還不能當成判斷一家公司實際風險控管能力的可靠指標——這也是為什麼獨立第三方評比報告的存在,對整個產業的透明度而言格外關鍵。

提問
請至少輸入 10 個字
相關新聞
更多相關主題