AI
AI 控制 (AI control)
概念
本站收录 1 集 · 0 条金句 · 关联 10 个
集里怎么说它
- 《超级智能为什么危险:Ryan Greenblatt 的推演与解法》(23:11起):本集把它说成’不是让 AI 想做正确的事,而是即使 AI 想干坏事也干不成’,具体包括监控所有 AI 内部流量、精细权限管理、追踪完整因果链、防止监督 AI 串通等
② 出现在这些集
1 集
③ 关联
点进去有真内容 —— 本页主要出口
Ryan Greenblatt · Matt Turk · Redwood Research · OpenAI · Anthropic · Google DeepMind · Meta · Hugging Face · 超级智能 · AI 伪装对齐
