Bible Network
Crypto
DeFi
Onchain
RWA
AI Agent
Stablecoin
Chain
SAFU
CryptoTax
DeFAI
AGI
Claude Me
Claude Skill
Claude Design
Claude Cowork
獨立知識媒體
與任何項目無關聯
AGI
Bible
繁中
EN
日本語
通用人工智慧,從理論到現實的全解析
agi-bible.com
最新動態
AGI 指標觀測
名詞解析
各方立場
風險與對齊
里程碑時間軸
產業影響
全球監管動態
最新
AI 會不會「裝乖」?Apollo Research 與 OpenAI 的策略性欺騙評測實際發現了什麼
·
AI 能自主工作多久?METR 時間視野指標半年翻倍,但這個數字比看起來複雜
·
全球 AI 監管三分天下:2026 年歐盟、美國、中國各自走上了哪條路
·
從 0% 到 92.5%,再被打回 0.37%:ARC-AGI 基準測試揭露的「進步」是哪一種進步
·
AI 到底搶走了多少工作?2026 年的數據跟新聞標題講的不太一樣
·
AGI 到底還要幾年?實驗室執行長跟學界研究者,看的是同一份證據卻得出完全相反的答案
首頁
›
名詞解析
›
capability-research
capability-research
思維鏈監控
讓推理模型把「怎麼想」的過程用自然語言寫出來,研究者再去讀這段文字,藉此觀察模型有沒有不當意圖或行為——這是目前少數不需要拆解模型內部結構、單靠讀模型自己說的話,就有機會發現問題的安全監控方法,但它的有效性建立在一個脆弱的前提上:模型寫出來的推理,是不是真的反映了它實際的決策過程。
intermediate
測試時算力
與其把運算資源全部砸在訓練階段,讓模型變得更大,改成在模型實際回答問題的當下,多花一點運算資源讓它「想久一點」——探索多條推理路徑、自我檢查、反覆修正——用這種方式換取答案品質的提升,是繼<a href="/zh/glossary/scaling-laws/compute-scaling/">算力規模化</a>之後,另一個驅動 AI 能力進步的獨立軸線。
advanced