可解
可解释性 (interpretability)
概念
本站收录 3 集 · 0 条金句 · 关联 10 个
集里怎么说它
- 《当 AI 变成黑客武器:给企业智能体修防火墙》(17:36起):本集把它说成:剖析深度学习模型内部激活回路和行为的科学。过去因耗费极大人力而进展缓慢,现在有望通过智能体将其自动化并迎来大爆发。
- 《超级智能为什么危险:Ryan Greenblatt 的推演与解法》(23:11起):本集提到 Redwood Research 最初关注可解释性(模型内部工作),后来发现不如预期有希望,转向了 AI 控制
- 《斯坦福语言学家的代币经济学:你的 token 贬值了》(11:09起):Chris 团队因成本低、且欢迎模型进步而转向的研究方向;他认为学界「不理解模型」是专业知识悖论,人们的理解远超所承认的
② 出现在这些集
3 集
- 《当 AI 变成黑客武器:给企业智能体修防火墙》 — 作为概念
- 《超级智能为什么危险:Ryan Greenblatt 的推演与解法》 — 作为概念(提及)
- 《斯坦福语言学家的代币经济学:你的 token 贬值了》 — 作为概念
③ 关联
点进去有真内容 —— 本页主要出口
Anthropic · 智能体 · Zico Kolter · Ryan Greenblatt · Sam Charrington · Matt Fredrikson · Matt Turk · Chris Potts · Gray Swan · Redwood Research
