JEV CEO:RLHF是走弯路 | RLHF | OpenAI | 大语言模型 | 人工智能 | Diogo Almeida | JEV | 机器学习 | AI泡沫 | AI经济革命
最佳拍档
0:00 / 0:00
JEV CEO:RLHF是走弯路 | RLHF | OpenAI | 大语言模型 | 人工智能 | Diogo Almeida | JEV | 机器学习 | AI泡沫 | AI经济革命
11 603 просмотра · 10 часов назад
最佳拍档
248 тыс. подписчиков
11 603 просмотра · 10 часов назад
前OpenAI核心成员、GPT-4与ChatGPT共同作者Diogo Almeida在两场技术分享中深入剖析了当前AI领域的核心矛盾:模型在辅助任务上表现惊艳,在自动化任务上却几乎不可用。他指出RLHF(基于人类反馈的强化学习)通过优化人类偏好,导致模型天然倾向于"过度承诺",产出的答案总是看起来貌似正确但实际可能有误。他重新解读了萨顿的"苦涩教训",提出"做对任务比数据重要,数据比算力重要",并以此解释Anthropic的崛起。他宣布自己的公司TypeSafe将放弃辅助能力,全力投入自动化方向,认为RLHF是AI发展史上一条本可避免的弯路,未来的AI应该是为自动化而生的,而不仅仅是更便宜地写代码。
• Jev CEO: I made ChatGPT, now I'm building ...
• Diogo Almeida (ex-OpenAI) reveals JEV: 200...