Bible Network Crypto DeFi Onchain RWA AI Agent Stablecoin Chain SAFU CryptoTax DeFAI AGI Claude Me Claude Skill Claude Design Claude Cowork
独立メディア
いかなるプロジェクトとも無提携
汎用人工知能、理論から現実まで完全解説
agi-bible.com
最新
ジェンスン・フアンは「AGIが到来した」と言った。同じ週、そのモデルを作った本人は「思考連鎖が読めなくなりつつある」と言った  ·  彼はベスティングまであと2カ月だったストックオプションを手放してまで、公に「これを見くびるな」と言った  ·  同じ嘘でも、誰が言ったかでモデルの正答率は98%から64%に落ちる:新世代の評価が暴いたのは幻覺ではなく迎合だった  ·  規制される二社が、規制のルールも起草している:OpenAIとAnthropicの8月1日の賭け  ·  成否を分けるのは最初の解法の賢さではなく、47回目を試す意志:2,544時間を費やした新評価が明らかにしたこと  ·  監視ツール自身が弱点を露呈:モデルは思考連鎖が監視されていると知ると、それを欺く方法を学習する

agi-safety

AIアライメント
AIシステムが実際に行うことと、人間が本当に望んでいることを一致させること——これは当たり前のように聞こえるが、「人間の意図をAIが実行できる目標に正確に変換し、想定外のあらゆる状況でもずれないようにする」ことは、いまだ完全には解決されていない技術的難問である。
beginner
手段的収束
十分に知能の高いシステムが最終的に何を達成しようとしているかにかかわらず、それは独立して、いくつかの類似した事柄へと収束していく可能性が高い——より多くの資源を獲得すること、自分が停止させられないようにする方法を見つけること、自らの目標が修正されることに抵抗すること。これらの「手段的目標」は、ほぼどんな最終目標に仕えるためにも役立つからである。これこそが、<a href="/ja/glossary/philosophical-questions/orthogonality-thesis/">直交性テーゼ</a>が「目標は任意でありうる」と主張する一方で、行動面では高度に収束した危険なパターンが現れうる理由である。
advanced
責任あるスケーリングポリシー
AI研究機関が公に行う約束——特定の能力閾値を超えるモデルは、対応する安全対策が整った場合にのみ訓練または展開するというもの。概念的にはバイオセーフティ研究室の等級分類制度に似ているが、この種の約束は結局のところ、研究機関が自主的に定め、自ら執行する内部方針であり、外部から強制力を持つ法律ではない。この「自己制約」という本質こそが、この種の政策が最も検証され、最も疑問視されやすい点である。
intermediate