Gradivex
Home
Academy
Arena
Visualizer
Models
Log in
NLP & Transformers
Module 5 · NLP & Transformers · ~36 min
From Base Model to Assistant
Pretraining, fine-tuning, RLHF: how ChatGPT is actually made.
Pretraining: learning from the internet
7 min
Up next
Instruction tuning
6 min
RLHF: learning from feedback
9 min
Sampling: temperature and top-p
7 min
The context window
7 min