Bible Network Crypto DeFi Onchain RWA AI Agent Stablecoin Chain SAFU CryptoTax DeFAI AGI Claude Me Claude Skill Claude Design Claude Cowork
獨立知識媒體
與任何項目無關聯
通用人工智慧,從理論到現實的全解析
agi-bible.com
最新
AI 會不會「裝乖」?Apollo Research 與 OpenAI 的策略性欺騙評測實際發現了什麼  ·  AI 能自主工作多久?METR 時間視野指標半年翻倍,但這個數字比看起來複雜  ·  全球 AI 監管三分天下:2026 年歐盟、美國、中國各自走上了哪條路  ·  從 0% 到 92.5%,再被打回 0.37%:ARC-AGI 基準測試揭露的「進步」是哪一種進步  ·  AI 到底搶走了多少工作?2026 年的數據跟新聞標題講的不太一樣  ·  AGI 到底還要幾年?實驗室執行長跟學界研究者,看的是同一份證據卻得出完全相反的答案

capability-research

思維鏈監控
讓推理模型把「怎麼想」的過程用自然語言寫出來,研究者再去讀這段文字,藉此觀察模型有沒有不當意圖或行為——這是目前少數不需要拆解模型內部結構、單靠讀模型自己說的話,就有機會發現問題的安全監控方法,但它的有效性建立在一個脆弱的前提上:模型寫出來的推理,是不是真的反映了它實際的決策過程。
intermediate
測試時算力
與其把運算資源全部砸在訓練階段,讓模型變得更大,改成在模型實際回答問題的當下,多花一點運算資源讓它「想久一點」——探索多條推理路徑、自我檢查、反覆修正——用這種方式換取答案品質的提升,是繼<a href="/zh/glossary/scaling-laws/compute-scaling/">算力規模化</a>之後,另一個驅動 AI 能力進步的獨立軸線。
advanced