Bible Network Crypto DeFi Onchain RWA AI Agent Stablecoin Chain SAFU CryptoTax DeFAI AGI Claude Me Claude Skill Claude Design Claude Cowork
獨立知識媒體
與任何項目無關聯
通用人工智慧,從理論到現實的全解析
agi-bible.com
最新
黃仁勳說「AGI 已經到來」,同一週,寫出這個模型的人說「思維鏈快要看不懂了」  ·  他放棄了兩個月後才會歸屬的股權,只為了公開說一句「別小看這個東西」  ·  同一句假話,換個人講,模型的準確率就從 98% 掉到 64%:新一代評測揭露的不是幻覺,是討好  ·  被監管的兩家公司,同時也在起草監管規則:OpenAI 與 Anthropic 的 8 月 1 日賭局  ·  決定成敗的不是第一次解法多聰明,是願不願意重跑第 47 次:一份耗時 2544 小時的新評測揭露了什麼  ·  監控工具自己說出了漏洞:一旦模型知道自己被思維鏈監控,就學會了怎麼騙過它

agi-safety

AI 對齊
確保 AI 系統實際做的事,跟人類真正想要它做的事一致——這聽起來理所當然,但「怎麼把人類意圖精確翻譯成 AI 能執行的目標,而且在各種沒預料到的情境下都不跑偏」,是一個至今沒有完全解決的技術難題。
beginner
工具性收斂
不管一個夠聰明的系統最終想達成什麼目標,它很可能都會不約而同地走向幾件相似的事——取得更多資源、想辦法讓自己不被關掉、抵抗自己的目標被修改——因為這些「工具性目標」不管拿來服務哪一種終極目標,幾乎都用得上,這也是為什麼<a href="/zh/glossary/philosophical-questions/orthogonality-thesis/">正交性論題</a>說「目標可以任意」的同時,行為上卻可能出現高度收斂的危險模式。
advanced
負責任擴展政策
一家 AI 實驗室公開承諾:只有在具備對應的安全防護措施之後,才會訓練或部署超過特定能力門檻的模型——概念上類似生物安全實驗室的分級制度,但這套承諾終究是實驗室自願訂立、自己執行的內部政策,而不是有外部強制力的法律,這個「自我約束」的本質,正是這類政策最常被檢驗、也最容易被質疑的地方。
intermediate