构建 ChatGPT:从预训练到 RLHF

Building ChatGPT: From Pretraining to RLHF

约翰·舒尔曼 John Schulman · The Robot Brains · 2023-08-03 · 约 57 分钟 · 原视频 ↗

打开互动全文版(中英对照 + 朗读 + 问答)→

本期速览 · Overview

OpenAI 联合创始人兼 ChatGPT 首席架构师 John Schulman 解释了该模型是如何通过预训练、监督微调和基于人类反馈的强化学习构建的。

John Schulman, co-founder of OpenAI and lead architect of ChatGPT, explains how the model is built through pretraining, supervised fine-tuning, and reinforcement learning from human feedback.

要点 · TL;DR

核心观点 · Key points

反共识 · Contrarian takes

本期章节 · Chapters(共 22)

阅读全文双语转录 →