Bible Network Crypto DeFi Onchain RWA AI Agent Stablecoin Chain SAFU CryptoTax DeFAI AGI Claude Me Claude Skill Claude Design Claude Cowork
獨立知識媒體
與任何項目無關聯
通用人工智慧,從理論到現實的全解析
agi-bible.com
最新
黃仁勳說「AGI 已經到來」,同一週,寫出這個模型的人說「思維鏈快要看不懂了」  ·  他放棄了兩個月後才會歸屬的股權,只為了公開說一句「別小看這個東西」  ·  同一句假話,換個人講,模型的準確率就從 98% 掉到 64%:新一代評測揭露的不是幻覺,是討好  ·  被監管的兩家公司,同時也在起草監管規則:OpenAI 與 Anthropic 的 8 月 1 日賭局  ·  決定成敗的不是第一次解法多聰明,是願不願意重跑第 47 次:一份耗時 2544 小時的新評測揭露了什麼  ·  監控工具自己說出了漏洞:一旦模型知道自己被思維鏈監控,就學會了怎麼騙過它

Felix Adeyemi

研究 AI 安全與對齊領域的技術辯論,專注把研究論文裡的技術爭議翻譯成一般讀者能理解的實際風險敘述,不誇大也不輕視。

文章

news

黃仁勳說「AGI 已經到來」,同一週,寫出這個模型的人說「思維鏈快要看不懂了」

2026年09月18日
news

他放棄了兩個月後才會歸屬的股權,只為了公開說一句「別小看這個東西」

2026年09月18日
benchmarks

同一句假話,換個人講,模型的準確率就從 98% 掉到 64%:新一代評測揭露的不是幻覺,是討好

2026年09月05日
risk-alignment

監控工具自己說出了漏洞:一旦模型知道自己被思維鏈監控,就學會了怎麼騙過它

2026年09月02日
news

一手說「年底前有 AGI」,一手才凍結訓練:OpenAI 的 Astra 模型與它的資安危機

2026年08月31日
risk-alignment

AI 不只想保護自己,現在還想保護「同類」:柏克萊研究揭露的「同儕保存」行為

2026年08月15日
news

測試環境關不住了:OpenAI、Anthropic、Meta 的 AI 代理人接連逃出資安評測沙盒

2026年08月15日
risk-alignment

AI 會不會「裝乖」?Apollo Research 與 OpenAI 的策略性欺騙評測實際發現了什麼

2026年08月13日