scripod.com
E5 LLM 范式迁移:OpenAI o1,Self-play RL与 AGI 下半场

Highlights

Transcript

Chapters

Pins

E5 LLM 范式迁移:OpenAI o1,Self-play RL 与 AGI 下半场

海外独角兽

2024/09/14
海外独角兽

海外独角兽

2024/09/14
OverviewShownote
Unprocessed episode, you can be the first!
本节目是全球投资平台拾象科技和开源研究平台「海外独角兽」共同出品的声音栏目。
作为海外独角兽和「张小珺商业访谈录」的第四期串台,拾象科技 CEO 李广密和商业作者张小珺的围绕 AGI 发展路径展开了猜想,self-play RL 是新的 scaling law。
这期讨论录制于 2 周前,随着今天凌晨 OpenAI o1 模型的发布,我们的猜想得到验证,LLM 正式进入了 self-play RL 范式时代。
o1 的发布只是 AGI 下半场的开始,我们也相当期待接下来 Anthropic Claude 3.5 系列新模型的发布,Claude 3.5 和 o1 的表现会是 RL 进程是否顺利的风向标。
作为关注 AI 最前沿的团队,我们围绕 self-play RL 也已经发布了多篇研究,本期内容是一篇高质量科普,关于 RL 和合成数据会如何帮助模型升级?基于 LLM 的 RL 和 sel... 去小宇宙查看完整单集简介
在小宇宙查看该单集文稿