Bible Network
Crypto
DeFi
Onchain
RWA
AI Agent
Stablecoin
Chain
SAFU
CryptoTax
DeFAI
AGI
Claude Me
Claude Skill
Claude Design
Claude Cowork
独立メディア
いかなるプロジェクトとも無提携
AGI
Bible
繁中
EN
日本語
汎用人工知能、理論から現実まで完全解説
agi-bible.com
最新動態
AGI指標観測
用語解説
各方の立場
リスクと整合
マイルストーン
産業への影響
グローバル規制
最新
AIは「良い子のふり」をするのか?Apollo ResearchとOpenAIの戦略的欺瞞評価が実際に発見したこと
·
AIは自律的にどれだけ長く働けるのか?METRの時間視野指標は数ヶ月で倍増——だがこの数字は見た目より複雑だ
·
世界のAI規制、三つ巴の様相:2026年、EU・米国・中国それぞれが歩む道
·
0%から92.5%へ、そして0.37%へ逆戻り:ARC-AGIベンチマークが明らかにする「進歩」の正体
·
AIは実際どれだけの仕事を奪ったのか?2026年のデータは見出しとは少し違う
·
AGIまであと何年か?企業CEOと学界研究者は同じ証拠を見ながら正反対の答えにたどり着く
ホーム
›
用語解説
›
agi-safety
agi-safety
AIアライメント
AIシステムが実際に行うことと、人間が本当に望んでいることを一致させること——これは当たり前のように聞こえるが、「人間の意図をAIが実行できる目標に正確に変換し、想定外のあらゆる状況でもずれないようにする」ことは、いまだ完全には解決されていない技術的難問である。
beginner
責任あるスケーリングポリシー
AI研究機関が公に行う約束——特定の能力閾値を超えるモデルは、対応する安全対策が整った場合にのみ訓練または展開するというもの。概念的にはバイオセーフティ研究室の等級分類制度に似ているが、この種の約束は結局のところ、研究機関が自主的に定め、自ら執行する内部方針であり、外部から強制力を持つ法律ではない。この「自己制約」という本質こそが、この種の政策が最も検証され、最も疑問視されやすい点である。
intermediate