RL
RLAIF
概念
本站收录 2 集 · 0 条金句 · 关联 10 个
集里怎么说它
- 《Mustafa Suleiman:数据是新的护城河——AI 创业者的机会地图》(18:47起):让更聪明的大模型自动完成成对比较、产出更大量监督标签的方法;Mustafa 团队过去 18-24 个月一直聚焦于此,但称其质量远未到完全取代人类。
- 《Anthropic 联合创始人:安全为什么不是添头,而是 Claude 性格的来源》(53:28起):本集将其定义为来自 AI 反馈的强化学习(reinforcement learning from AI feedback),是宪法 AI 的实现方式,优点是可扩展、不需要大量人类,但风险是模型在盒子里自我改进时可能发展出秘密目标。
② 出现在这些集
2 集
③ 关联
点进去有真内容 —— 本页主要出口
OpenAI · 后训练 · 智能体 · Seth Rosenberg · Lenny · Mustafa Suleyman · Benjamin Mann · DeepMind · Anthropic · Inflection AI
