Bible Network Crypto DeFi Onchain RWA AI Agent Stablecoin Chain SAFU CryptoTax DeFAI AGI Claude Me Claude Skill Claude Design Claude Cowork
独立メディア
いかなるプロジェクトとも無提携
汎用人工知能、理論から現実まで完全解説
agi-bible.com
最新
AIは「良い子のふり」をするのか?Apollo ResearchとOpenAIの戦略的欺瞞評価が実際に発見したこと  ·  AIは自律的にどれだけ長く働けるのか?METRの時間視野指標は数ヶ月で倍増——だがこの数字は見た目より複雑だ  ·  世界のAI規制、三つ巴の様相:2026年、EU・米国・中国それぞれが歩む道  ·  0%から92.5%へ、そして0.37%へ逆戻り:ARC-AGIベンチマークが明らかにする「進歩」の正体  ·  AIは実際どれだけの仕事を奪ったのか?2026年のデータは見出しとは少し違う  ·  AGIまであと何年か?企業CEOと学界研究者は同じ証拠を見ながら正反対の答えにたどり着く

capability-research

思考連鎖監視
推論モデルに「どう考えたか」というプロセスを自然言語で書き出させ、研究者がそのテキストを読むことで問題のある意図や挙動がないかを観察する手法——現在、モデルの内部構造を分解する必要がなく、モデル自身が語る言葉を読むだけで問題を発見できる可能性がある数少ない安全監視手法の一つである。しかしその有効性は、書き出された推論が実際の意思決定プロセスを本当に反映しているかどうかという、脆弱な前提の上に成り立っている。
intermediate
テスト時計算量
訓練段階にすべての計算資源を注ぎ込んでモデルを大きくするのではなく、モデルが実際に質問に答えるその瞬間に追加の計算資源を費やし、複数の推論経路を探索し、自己チェックし、繰り返し修正することで「より長く考え」させ、その追加の計算量を回答品質の向上と引き換えにする手法。<a href="/ja/glossary/scaling-laws/compute-scaling/">コンピュート・スケーリング</a>とは別の、AI能力向上を牽引する独立した軸である。
advanced