Bible Network Crypto DeFi Onchain RWA AI Agent Stablecoin Chain SAFU CryptoTax DeFAI AGI Claude Me Claude Skill Claude Design Claude Cowork
獨立知識媒體
與任何項目無關聯
通用人工智慧,從理論到現實的全解析
agi-bible.com
最新
黃仁勳說「AGI 已經到來」,同一週,寫出這個模型的人說「思維鏈快要看不懂了」  ·  他放棄了兩個月後才會歸屬的股權,只為了公開說一句「別小看這個東西」  ·  同一句假話,換個人講,模型的準確率就從 98% 掉到 64%:新一代評測揭露的不是幻覺,是討好  ·  被監管的兩家公司,同時也在起草監管規則:OpenAI 與 Anthropic 的 8 月 1 日賭局  ·  決定成敗的不是第一次解法多聰明,是願不願意重跑第 47 次:一份耗時 2544 小時的新評測揭露了什麼  ·  監控工具自己說出了漏洞:一旦模型知道自己被思維鏈監控,就學會了怎麼騙過它
news

他放棄了兩個月後才會歸屬的股權,只為了公開說一句「別小看這個東西」

30 秒速讀
他選擇在股權歸屬前兩個月辭職——這代表他離開時,放棄的不只是一份工作,還有一筆本來唾手可得的錢。

完整解析 +
01 · 為什麼發生?

為什麼 Coxon 選擇在股權歸屬前離職這個細節,會被多家媒體特別強調?

因為這個細節直接排除了一個最常見、也最容易讓事件被淡化的解釋方向:待遇不滿或職涯規劃。如果一個人只是想換工作、或是對薪酬福利有意見,理性的做法通常是等股權歸屬、把該拿的錢拿到手之後再離開,這樣完全不影響換工作的自由,卻能保住已經工作換來的財務利益。Coxon 選擇在歸屬前整整兩個月離職,代表他是在明知會直接損失一筆已經非常接近到手的錢的情況下,仍然選擇立刻走人。

這讓外界很難用「這只是一次普通的人事異動」來解讀這次辭職,也是為什麼《Axios》會特別把這個細節寫進報導標題——放棄唾手可得的財務利益,通常被視為一個人對自己所表達立場抱持高度確信的具體行為證據,而不只是言語上的表態。

02 · 運作原理是什麼?

Coxon 自己也說「沒有親眼看到 Anthropic 犧牲安全標準」,這是不是代表他的擔憂其實沒有具體證據支撐?

這是個容易被簡化理解的地方。Coxon 的說法區分了兩個不同層次的問題:一個是「目前有沒有發生」,另一個是「結構上會不會發生」。他明確表示,自己沒有親眼目睹 Anthropic 為了勝出而犧牲安全標準,這代表他的擔憂不是基於某個他目擊過的具體違規事件。

但他真正擔心的,是這個產業目前的競爭結構本身——多家實驗室彼此競爭、同時還要面對來自中國的競爭壓力——這種結構性的壓力,長期而言會讓任何一家公司都很難完全抵抗「抄捷徑」或「跳過監督步驟」的誘因,即使這家公司目前的意圖是真誠的。換句話說,他的擔憂不是指控 Anthropic 現在做錯了什麼,而是對整個產業的競爭動態,在長期時間尺度下會把所有參與者推向哪個方向,提出的一種結構性判斷——這種判斷確實比「我看到具體違規證據」更難被驗證,但也不代表它完全沒有根據,因為這種結構性壓力本身是可以被觀察與分析的。

03 · 如何應用

Evan Hubinger 公開確認 Coxon 的說法,具體代表什麼意義?跟 Coxon 本人的發言有什麼不同?

Evan Hubinger 的角色跟 Coxon 完全不同——他不是離職員工,而是目前仍在 Anthropic 內部、負責對齊科學團隊的在職資深研究者。他選擇在 Coxon 辭職後短短數天內公開表態,證實 Coxon 說法的實質內容,並主動提出自己對「AI 導致人類滅絕」機率的具體估計(未來十年內超過 10%),這個舉動的意義跟 Coxon 的辭職聲明性質不同。

Coxon 的發言是一個人選擇離開產業、把疑慮說出來;Hubinger 的發言則是一個人選擇留在產業內部、同時公開附議這種疑慮,等於是在公司內部持續工作的同時,承擔了公開表態的風險。這種「在職且資深」的公開確認,通常比一個已經離職的人的說法更難被外界解讀為「單純的個人情緒發洩」或「跟公司有嫌隙後的報復性言論」,因為 Hubinger 沒有明顯的動機去誇大風險——他仍然是這家公司的員工,這種表態某種程度上也是在公開質疑自己所屬機構目前的做法是否足夠。

04 · 我該怎麼做?

一般讀者不是 AI 從業者,該怎麼理性看待這種末日式的警告,而不是陷入恐慌或完全無視兩種極端?

比較實用的做法,是把注意力從「這個具體預言準不準」轉移到「這種聲音的模式有沒有在改變」。Coxon 個人對 2027 年是否失控的判斷,本質上是一個無法在事發前被驗證的預測,糾結這個數字準不準,對一般讀者而言參考價值有限。

真正值得追蹤的,是這類公開、具名、有實際研發經歷的內部警告,出現的頻率跟具體程度,是否隨著時間推移而增加。今年之內,已經出現 Google DeepMind 研究員因國防合約疑慮辭職、多家實驗室員工聯署《放緩前沿》聲明、以及這次 Coxon 辭職並獲得在職資深研究者公開附議,三起獨立案例。如果類似的模式持續增加、且涉及的人員層級愈來愈資深、愈來愈願意具名發聲,這本身就是一個比任何單一預言都更值得留意的訊號;反之,如果這類聲音逐漸減少或不再獲得公司內部任何形式的呼應,也同樣是值得記錄的訊號。

完整內容 +

2026 年 9 月 8 日,27 歲的 Anthropic 預訓練研究員 Jacob Coxon 在 X 平台上發布一則七段式貼文,宣布自己已經從 Anthropic 辭職,並將完全離開整個 AI 產業。這則貼文在一夜之間累積將近 7600 萬次瀏覽,同一天,《華爾街日報》刊出對他的獨家專訪,進一步放大了這則消息的擴散速度。「我今天從 Anthropic 辭職了,」他寫道,「過去三年,我先後在 OpenAI 與 Anthropic 做預訓練研究,這兩家公司都沒有負責任地行事。他們正直奔自我改進型超級智能而去,拿我們所有人的性命下賭注。」

他不是外部批評者,是核心研究員本人

Coxon 的背景讓這則辭職聲明的份量跟一般網路上的 AI 風險評論截然不同。他畢業於劍橋大學,2023 年至 2026 年 7 月在 OpenAI 任職,是 GPT-4o 核心貢獻者之一,隨後於今年稍早加入 Anthropic,同樣專注於預訓練研究——這是 AI 模型開發裡運算資源需求最龐大、資本投入最密集、技術門檻也最高的一個環節。換句話說,他不是從外部觀察這個產業,而是過去三年裡,實際參與打造這些前沿模型的人之一。

根據 Axios 的專訪,Coxon 表示自己今年稍早加入 Anthropic,正是看中這家公司在安全議題上的名聲。他也明確表示,自己並沒有親眼看到 Anthropic 為了在競爭中勝出而犧牲安全標準。但他真正擔心的是未來:「如果你被逼著參與這場競賽,你就必須抄捷徑」,或是「在監督流程裡跳過某些步驟」。他同時坦承,業界目前確實存在某種「對 OpenAI、對中國過度偏執」的氛圍,而這種偏執有時候會被拿來當成繼續往前衝的正當理由——這段話讓他的立場顯得更為複雜,而不是單純的產業內部揭弊。

辭職的代價:放棄即將歸屬的股權

根據《Axios》的報導,Coxon 選擇辭職的時間點,是在他的股權完成歸屬(vest)的整整兩個月之前——這代表他是在明知會直接放棄一筆即將到手的財務利益的情況下,選擇立刻離開。這個細節之所以重要,是因為它讓外界很難用「這只是一次待遇糾紛或職涯規劃」來解讀這次辭職:一個人如果只是想換工作或抱怨薪酬,通常會等股權歸屬之後再走,而不是主動放棄唾手可得的利益。他向《華爾街日報》表示:「我們正走在許多最激進情境的軌道上,到明年底,事情很可能已經失控。」他也提到,Anthropic 內部的同事會用「危機時刻」(crunchtime)與「終局」(endgame)這類詞彙,來形容目前這種被加速推進的自我改進型 AI 模型所處的狀態。

公司內部並非一片沉默——有人公開附和了他的說法

這起事件之所以沒有像過去許多類似的離職聲明那樣迅速被淡化,關鍵在於 Anthropic 內部並未選擇集體噤聲。公司的對齊科學團隊負責人 Evan Hubinger 公開證實了 Coxon 說法的實質內容,並表示他自己對「AI 導致人類滅絕」這件事的機率估計,在未來十年內超過 10%。一名資深安全研究人員在數天內就公開站出來、在紀錄上承認自己也在憂心同一件事,這跟過去多數類似辭職事件裡「公司選擇不予置評、外界很快遺忘」的劇本明顯不同。Anthropic 目前尚未針對 Coxon 的具體說法發表正式聲明。

值得留意的是,這並非今年唯一一起類似案例。2026 年 6 月,Google DeepMind 研究員 Alex Turner 也曾以類似理由辭職,原因是他認為公司與美國國防部之間的 AI 合約,缺乏對自主武器系統的明確限制。同一年稍早,Anthropic 員工也曾是 7 月發布的《放緩前沿》(Pacing the Frontier)聲明的聯署人之一,該聲明同樣有來自 OpenAI、Google DeepMind 與 Meta 的員工共同參與。這代表 Coxon 的辭職不是孤立事件,而是今年以來,前沿實驗室內部員工陸續透過具名、公開方式表達類似憂慮的其中一個案例——而且這些聲音正變得愈來愈頻繁、愈來愈具體。

時機點的巧合,也引發了另一種解讀

Coxon 的辭職發生在 9 月 8 日,正好是 OpenAI 發布 GPT-6 Astra 五天後,也是 OpenAI 首席科學家 Jakub Pachocki 發表〈異星心智〉一文警告「沒有一家實驗室的監控能力足以負責任地繼續全速擴張」的同一週。網路上因此流傳一種說法,認為這個時間點的重疊並非巧合。這種揣測目前缺乏具體證據支持,但無論背後的時間安排是否經過刻意設計,這幾件事實際發生的時間點確實高度重疊:一週之內,一家實驗室的首席科學家公開承認監控機制正在失效,另一家實驗室的核心研究員公開辭職、警告產業正在拿人命下賭注,而該公司的資深安全研究員又緊接著出面確認了這個憂慮的實質內容。

這跟你的錢有什麼關係

對於評估 AI 相關投資的讀者而言,Coxon 辭職事件真正該被記住的,不是他個人對 2027 年是否失控這個具體時間點的預測準不準——這一點目前根本無法驗證。真正有參考價值的,是這起事件所確立的一個模式:越來越多前沿實驗室內部、具名、有實際研發經歷的員工,正在用公開、留下紀錄的方式表達同一種憂慮——競爭壓力,而不是技術準備程度,才是目前決定超級智能開發速度的主要因素。這個模式已經在一年之內,橫跨兩家不同公司、由多位具名在職或離職人士獨立印證,而不是單一個人的一次性發言。

對於正在評估 Anthropic(目前正籌備上市)或其他前沿實驗室曝險的讀者而言,這代表接下來值得持續追蹤的訊號,不只是這些公司的產品發布與營收數字,也包括:公司內部是否還會出現更多具名員工公開表達類似憂慮、公司對這類聲明的回應方式是選擇正面說明還是沉默處理、以及像 Evan Hubinger 這樣的資深安全人員,是否會持續公開站出來確認或修正這些說法。這些訊號的走向,比任何一次模型能力發布,都更直接反映一家公司內部對自身安全風險的真實評估。

資料來源:Scoop: Anthropic whistleblower gave up his equity to leave the company — Axios'Gambling with our lives': AI researcher quits Anthropic and leaves AI entirely — Yahoo FinanceAnthropic Researcher Jacob Coxon Resigns, Warns AI Industry Is "Gambling With Our Lives" — Yahoo NewsEx-Anthropic Researcher Jacob Coxon Quits, Says AI Leaders Fear It Could 'Kill Us All' — IBTimes UK
提問
請至少輸入 10 個字
相關文章
同一句假話,換個人講,模型的準確率就從 98% 掉到 64%:新一代評測揭露的不是幻覺,是討好
benchmarks · 09/05
被監管的兩家公司,同時也在起草監管規則:OpenAI 與 Anthropic 的 8 月 1 日賭局
regulation · 09/05
決定成敗的不是第一次解法多聰明,是願不願意重跑第 47 次:一份耗時 2544 小時的新評測揭露了什麼
milestones · 09/05
監控工具自己說出了漏洞:一旦模型知道自己被思維鏈監控,就學會了怎麼騙過它
risk-alignment · 09/02
相關新聞