Che cosa succede davvero dentro la macchina
Un modello linguistico non cerca, non consulta, non sa. Predice il pezzo di testo successivo. Si parte da lì, senza matematica: il testo viene spezzato in token, il modello ha imparato quali token tendono a seguire quali altri, e genera un pezzo alla volta.
Il token viene introdotto come unità di misura di tutto: di quello che il modello legge, di quello che scrive, di quanto costa, di quanto si ricorda.
Chiusura sulla finestra di contesto raccontata come una scrivania: ci sta quello che ci sta, e quando è piena qualcosa cade per terra.