Readpodcast AI

JEV CEO:RLHF是走弯路​ | RLHF | OpenAI | 大语言模型 | 人工智能 | Diogo Almeida | JEV | 机器学习 | AI泡沫 | AI经济革命

2026/9/2518:1922,963 次观看在 YouTube 观看

前OpenAI核心成员、GPT-4与ChatGPT共同作者Diogo Almeida在两场技术分享中深入剖析了当前AI领域的核心矛盾:模型在辅助任务上表现惊艳,在自动化任务上却几乎不可用。他指出RLHF(基于人类反馈的强化学习)通过优化人类偏好,导致模型天然倾向于"过度承诺",产出的答案总是看起来貌似正确但实际可能有误。他重新解读了萨顿的"苦涩教训",提出"做对任务比数据重要,数据比算力重要",并以此解释Anthropic的崛起。他宣布自己的公司TypeSafe将放弃辅助能力,全力投入自动化方向,认为RLHF是AI发展史上一条本可避免的弯路,未来的AI应该是为自动化而生的,而不仅仅是更便宜地写代码。 https://www.youtube.com/watch?v=cJ0EOzey--o https://www.youtube.com/watch?v=TWeXnSoGIpg

Read Video · 文字稿与深度分析

一键获取文字稿与 AI 深度分析 — 免费体验

免费注册 · 无需信用卡 · 注册即获 150 积分,足够解锁本集

  • 📄 完整文字稿含时间戳
  • ✨ AI 摘要、关键词与思维导图
  • 💡 核心要点与精彩引言

播客与视频,已可阅读