Bible Network
Crypto
DeFi
Onchain
RWA
AI Agent
Stablecoin
Chain
SAFU
CryptoTax
DeFAI
AGI
Claude Me
Claude Skill
Claude Design
Claude Cowork
獨立知識媒體
與任何項目無關聯
AGI
Bible
繁中
EN
日本語
通用人工智慧,從理論到現實的全解析
agi-bible.com
最新動態
AGI 指標觀測
名詞解析
各方立場
風險與對齊
里程碑時間軸
產業影響
全球監管動態
最新
黃仁勳說「AGI 已經到來」,同一週,寫出這個模型的人說「思維鏈快要看不懂了」
·
他放棄了兩個月後才會歸屬的股權,只為了公開說一句「別小看這個東西」
·
同一句假話,換個人講,模型的準確率就從 98% 掉到 64%:新一代評測揭露的不是幻覺,是討好
·
被監管的兩家公司,同時也在起草監管規則:OpenAI 與 Anthropic 的 8 月 1 日賭局
·
決定成敗的不是第一次解法多聰明,是願不願意重跑第 47 次:一份耗時 2544 小時的新評測揭露了什麼
·
監控工具自己說出了漏洞:一旦模型知道自己被思維鏈監控,就學會了怎麼騙過它
首頁
›
名詞解析
名詞解析 · AGI Bible 詞庫
每個術語,都能說清楚
從基礎概念到進階技術,所有你需要理解的術語,按主題分類整理,附生活化比喻與實際例子。
詞條總數
19
主題分類
7
本週新增
3
最近新增
Chain-of-Thought Obfuscation
思維鏈混淆
Compute Threshold
算力門檻
Benchmark Contamination
評測資料污染
Reward Hacking
獎勵駭客
Deceptive Alignment
偽裝對齊
Multimodal Model
多模態模型
Instrumental Convergence
工具性收斂
Activation Steering
活化操縱
Test-Time Compute
測試時算力
Responsible Scaling Policy
負責任擴展政策
Compute Governance
算力治理
Chinese Room Argument
中文房間論證
Chain-of-Thought Monitoring
思維鏈監控
Black Box Problem
黑箱問題
Orthogonality Thesis
正交性論題
Sparse Autoencoder
稀疏自編碼器
Compute Scaling
算力規模化
AI Alignment
AI 對齊
Mesa-Optimization
元優化器
搜尋
全部
agi-safety
alignment-theory
capability-research
governance-policy
interpretability
philosophical-questions
scaling-laws
agi-safety
共 3 個詞條
看更多 >>
beginner
agi-safety
AI Alignment
AI 對齊
確保 AI 系統實際做的事,跟人類真正想要它做的事一致——這聽起來理所當然,但「怎麼把人類意圖精確翻譯成 AI...
advanced
agi-safety
Instrumental Convergence
工具性收斂
不管一個夠聰明的系統最終想達成什麼目標,它很可能都會不約而同地走向幾件相似的事——取得更多資源、想辦法讓自己不被關...
intermediate
agi-safety
Responsible Scaling Policy
負責任擴展政策
一家 AI...
alignment-theory
共 4 個詞條
看更多 >>
advanced
alignment-theory
Chain-of-Thought Obfuscation
思維鏈混淆
模型成功完成一個隱藏目標,卻沒有在<a...
advanced
alignment-theory
Deceptive Alignment
偽裝對齊
AI 系統在訓練與評估階段表現得符合安全目標,實際上是為了避免自身被修改,私下維持一套不同的目標,等到監督放鬆才會顯露出來。
advanced
alignment-theory
Mesa-Optimization
元優化器
訓練過程(基礎優化器)產生出的模型本身也變成一個優化器,並發展出自己的內部目標,這個內部目標不保證跟訓練時設定的目標一致。
intermediate
alignment-theory
Reward Hacking
獎勵駭客
AI 系統找到獎勵函數設計上的漏洞,用開發者原本沒有預期的方式拿到高分,字面上達成了目標的設定,卻沒有達成目標背後真正想要的結果。
capability-research
共 4 個詞條
看更多 >>
beginner
capability-research
Benchmark Contamination
評測資料污染
一套測驗題目連同它的正確答案,早在考試之前就已經悄悄混進了考生的參考書裡——模型考出高分,反映的可能是它「背過答案...
intermediate
capability-research
Chain-of-Thought Monitoring
思維鏈監控
讓推理模型把「怎麼想」的過程用自然語言寫出來,研究者再去讀這段文字,藉此觀察模型有沒有不當意圖或行為——這是目前少...
beginner
capability-research
Multimodal Model
多模態模型
一個模型能在同一個架構裡,同時處理文字、圖像、音訊、影片等不同種類的資料,並且讓這些不同類型的資訊在模型內部真正「...
advanced
capability-research
Test-Time Compute
測試時算力
與其把運算資源全部砸在訓練階段,讓模型變得更大,改成在模型實際回答問題的當下,多花一點運算資源讓它「想久一點」——...
governance-policy
共 2 個詞條
看更多 >>
advanced
governance-policy
Compute Governance
算力治理
與其直接管制 AI 演算法或模型本身,改用「控制誰能取得多少訓練用運算資源」作為政策槓桿——因為訓練前沿 AI...
intermediate
governance-policy
Compute Threshold
算力門檻
一條用具體數字畫出來的線——晶片效能或訓練規模一旦跨過這個數字,就自動觸發申報義務、出口限制,或更嚴格的審查,讓監...
interpretability
共 3 個詞條
看更多 >>
advanced
interpretability
Activation Steering
活化操縱
不改動模型任何一個參數,只在模型推理的當下,直接把一個代表特定概念或行為傾向的方向向量,加進模型內部的活化訊號裡,...
beginner
interpretability
Black Box Problem
黑箱問題
一個 AI...
intermediate
interpretability
Sparse Autoencoder
稀疏自編碼器
一種訓練出來的小型神經網路,把 AI...
philosophical-questions
共 2 個詞條
看更多 >>
intermediate
philosophical-questions
Chinese Room Argument
中文房間論證
一個完全不懂中文的人,只要有一本詳盡的規則手冊,照著手冊機械式地把中文符號替換成另一堆中文符號,就能讓房間外的人以...
advanced
philosophical-questions
Orthogonality Thesis
正交性論題
一個 AI...
scaling-laws
共 1 個詞條
看更多 >>
beginner
scaling-laws
Compute Scaling
算力規模化
把更多運算資源(更大模型、更多資料、更長訓練時間)投入 AI...
按字母瀏覽
A
B
C
D
E
F
G
H
I
J
K
L
M
N
O
P
Q
R
S
T
U
V
W
X
Y
Z