Bible Network
Crypto
DeFi
Onchain
RWA
AI Agent
Stablecoin
Chain
SAFU
CryptoTax
DeFAI
AGI
Claude Me
Claude Skill
Claude Design
Claude Cowork
独立メディア
いかなるプロジェクトとも無提携
AGI
Bible
繁中
EN
日本語
汎用人工知能、理論から現実まで完全解説
agi-bible.com
最新動態
AGI指標観測
用語解説
各方の立場
リスクと整合
マイルストーン
産業への影響
グローバル規制
最新
ジェンスン・フアンは「AGIが到来した」と言った。同じ週、そのモデルを作った本人は「思考連鎖が読めなくなりつつある」と言った
·
彼はベスティングまであと2カ月だったストックオプションを手放してまで、公に「これを見くびるな」と言った
·
同じ嘘でも、誰が言ったかでモデルの正答率は98%から64%に落ちる:新世代の評価が暴いたのは幻覺ではなく迎合だった
·
規制される二社が、規制のルールも起草している:OpenAIとAnthropicの8月1日の賭け
·
成否を分けるのは最初の解法の賢さではなく、47回目を試す意志:2,544時間を費やした新評価が明らかにしたこと
·
監視ツール自身が弱点を露呈:モデルは思考連鎖が監視されていると知ると、それを欺く方法を学習する
ホーム
›
用語解説
用語解説 · AGI Bible 用語ライブラリ
すべての用語を分かりやすく
基本概念から高度な技術まで、必要な用語をトピック別に整理。わかりやすい解説と具体例で学べます。
用語数
19
トピック数
7
今週追加
3
最近追加
思考連鎖の難読化
算力閾値
ベンチマーク汚染
報酬ハッキング
欺瞞的アライメント
マルチモーダルモデル
手段的収束
活性化操作
テスト時計算量
責任あるスケーリングポリシー
コンピュート・ガバナンス
中国語の部屋論証
思考連鎖監視
ブラックボックス問題
直交性テーゼ
スパースオートエンコーダー
コンピュート・スケーリング
AIアライメント
メサ最適化
検索
すべて
AGI Safety
Alignment Theory
Capability Research
Governance & Policy
Interpretability
Philosophical Questions
Scaling Laws
AGI Safety
3 用語
すべて見る >>
beginner
AGI Safety
AIアライメント
AIシステムが実際に行うことと、人間が本当に望んでいることを一致させること——これは当たり前のように聞こえるが、「...
advanced
AGI Safety
手段的収束
十分に知能の高いシステムが最終的に何を達成しようとしているかにかかわらず、それは独立して、いくつかの類似した事柄へ...
intermediate
AGI Safety
責任あるスケーリングポリシー
AI研究機関が公に行う約束——特定の能力閾値を超えるモデルは、対応する安全対策が整った場合にのみ訓練または展開する...
Alignment Theory
4 用語
すべて見る >>
advanced
Alignment Theory
思考連鎖の難読化
モデルが隠された目標を達成しながら、監視システムが検出できるような痕跡を思考連鎖に一切残さない状態——推論をしてい...
advanced
Alignment Theory
欺瞞的アライメント
AIシステムが訓練・評価段階では安全目標に沿っているように振る舞うが、それは自らの根底にある目標が修正されるのを避...
advanced
Alignment Theory
メサ最適化
訓練プロセス(ベースオプティマイザ)が生成したモデル自体が最適化器となり、独自の内部目標を持つ現象。この内部目標は...
intermediate
Alignment Theory
報酬ハッキング
AIシステムが報酬の設計上の抜け穴を見つけ、設計者が意図しなかった方法でそれを利用して高得点を得る現象。目標の文字...
Capability Research
4 用語
すべて見る >>
beginner
Capability Research
ベンチマーク汚染
テスト問題とその正解が、試験が行われる前にひそかに受験者の参考書に紛れ込んでしまっている状態——モデルが高得点を取...
intermediate
Capability Research
思考連鎖監視
推論モデルに「どう考えたか」というプロセスを自然言語で書き出させ、研究者がそのテキストを読むことで問題のある意図や...
beginner
Capability Research
マルチモーダルモデル
テキスト、画像、音声、動画といった異なる種類のデータを、単一のアーキテクチャの中で同時に処理し、これらの異なる種類...
advanced
Capability Research
テスト時計算量
訓練段階にすべての計算資源を注ぎ込んでモデルを大きくするのではなく、モデルが実際に質問に答えるその瞬間に追加の計算...
Governance & Policy
2 用語
すべて見る >>
advanced
Governance & Policy
コンピュート・ガバナンス
AIのアルゴリズムやモデル自体を直接規制するのではなく、「誰がどれだけの訓練用計算資源にアクセスできるか」を制御す...
intermediate
Governance & Policy
算力閾値
具体的な数字で引かれた一本の線——チップの性能や訓練の規模がこの数字を超えると、申告義務、輸出制限、あるいはより厳...
Interpretability
3 用語
すべて見る >>
advanced
Interpretability
活性化操作
モデルのパラメータを一つも変更することなく、推論の瞬間にモデル内部の活性化信号に、特定の概念や行動傾向を表す方向ベ...
beginner
Interpretability
ブラックボックス問題
AIモデルは正しい答えを出すことができるが、それを開発したエンジニアを含め、誰もそのモデルがなぜその答えにたどり着...
intermediate
Interpretability
スパースオートエンコーダー
AIモデル内部の絡み合った、解釈が困難なニューロンの活性化信号を、それぞれが単一の識別可能な概念に対応する多数の「...
Philosophical Questions
2 用語
すべて見る >>
intermediate
Philosophical Questions
中国語の部屋論証
中国語をまったく理解しない人物が、十分に詳細なルールブックさえあれば、そのルールに従って中国語の記号を別の中国語の...
advanced
Philosophical Questions
直交性テーゼ
AIシステムの知能の高さと、それが追求する目標は、原則として互いに独立した変数である——超知能システムであっても、...
Scaling Laws
1 用語
すべて見る >>
beginner
Scaling Laws
コンピュート・スケーリング
より大きなモデル、より多くのデータ、より長い訓練時間といった、より多くの計算資源をAI訓練に投入すると、モデルの能...
アルファベット索引
A
B
C
D
E
F
G
H
I
J
K
L
M
N
O
P
Q
R
S
T
U
V
W
X
Y
Z