La tappa storica
GPT-2 è il modello presentato da OpenAI il 14 febbraio 2019. Il modello più grande aveva circa 1,5 miliardi di parametri; il rilascio avvenne per tappe, fino alla pubblicazione della variante completa il 5 novembre dello stesso anno. Raccontarlo aiuta a capire quanto sia recente l’abitudine di parlare con un modello come con un assistente.
Che cosa cambiò
Il compito fondamentale era continuare il testo ricevuto, prevedendo i token successivi. Il progetto descriveva capacità emergenti su diversi compiti senza un addestramento specifico per ciascuno. GPT-2 non era però un chatbot istruito come quelli attuali: una domanda poteva diventare l’inizio di un documento, invece di ricevere una risposta diretta. Il codice ufficiale è disponibile con licenza MIT.
Come leggerlo e provarlo
Per un esercizio didattico, prova lo stesso incipit tre volte e osserva come cambia la continuazione. Poi trasforma una domanda in un esempio di documento: titolo, contesto e prima frase della risposta. Il confronto mostra perché il formato del prompt aveva un peso diverso da quello di una moderna conversazione. Una continuazione plausibile può comunque contenere fatti inventati.
Hardware: pesi e memoria totale
La taglia da 1,5B suggerisce circa 3 GB per i soli pesi a 16 bit: è una stima aritmetica nominale, non un requisito completo misurato. Servono anche memoria per esecuzione e contesto. Le taglie minori consentivano esperimenti più leggeri; la distribuzione del programma, il formato e le dipendenze dell’epoca rendevano l’avvio meno immediato rispetto alle applicazioni odierne.
Ha ancora senso nel 2026?
Nel 2026 lo consideriamo soprattutto un modello da studiare, utile per capire generazione autoregressiva, campionamento e differenza fra preaddestramento e istruzioni. Per il lavoro quotidiano sul codice o per un assistente italiano partirei dalle schede moderne della categoria. Qui non attribuiamo a GPT-2 una prova personale: la valutazione è storica e didattica, senza benchmark NexastraTech.
Seguire la storia
Questi sei approfondimenti sono una selezione di tappe fra il 2019 e il 2023, non una storia completa dell’intelligenza artificiale. Gli esperimenti moderni con Bonsai e GLM sono trattati separatamente, senza attribuire ai vecchi modelli risultati misurati su altri checkpoint.
Fonti originali e documentazione
Fonti consultate il 5 ottobre 2026. Le date del modello descrivono l’evento storico; la data dell’articolo indica la pubblicazione su NexastraTech. Le stime di memoria sono calcoli nominali a 2 byte per parametro, in GB decimali, non benchmark o requisiti garantiti.
