La tappa storica
Meta annunciò LLaMA il 24 febbraio 2023, in taglie 7B, 13B, 33B e 65B. Il 13 marzo Stanford CRFM presentò Alpaca, ottenuto adattando LLaMA 7B a seguire istruzioni. Le due tappe raccontano componenti diverse: il modello di base e il successivo adattamento del comportamento.
Che cosa cambiò
Stanford descrive un addestramento su 52.000 dimostrazioni generate tramite text-davinci-003. Alpaca non è quindi un’architettura completamente nuova: modifica un checkpoint LLaMA con dati di istruzioni. La prima LLaMA aveva un accesso e una licenza orientati alla ricerca; il progetto Alpaca indicava limiti di uso non commerciale. Non vanno applicate retroattivamente le condizioni delle successive famiglie Llama.
Come leggerlo e provarlo
Il passaggio alle istruzioni rendeva più naturale chiedere un riassunto o una trasformazione del testo. Per osservare la differenza, presenta lo stesso contenuto a un modello di base e a uno istruito, usando il formato previsto da ciascuno. Misura la conformità alla richiesta: un testo elegante non basta se il modello aggiunge informazioni o ignora il formato.
Hardware: pesi e memoria totale
Per un 7B a 16 bit, il conto nominale è circa 14 GB di soli pesi, prima di contesto e strutture di esecuzione. La quantizzazione contribuì alla diffusione degli esperimenti su hardware domestico, ma va distinta dall’adattamento alle istruzioni: una riduce la precisione dei pesi, l’altro modifica il comportamento appreso. Non tutte le combinazioni preservano la stessa qualità.
Ha ancora senso nel 2026?
Questa coppia è centrale per capire la genealogia dei chatbot della comunità. Oggi la leggerei come storia tecnica, non come suggerimento di scaricare un vecchio file non identificato. Prima di riprodurre una prova, verifica provenienza, revisione e condizioni del checkpoint. L’articolo non descrive Llama 2, Llama 3 o un prodotto Meta attuale: riguarda la prima generazione e Alpaca del 2023.
Seguire la storia
Questi sei approfondimenti sono una selezione di tappe fra il 2019 e il 2023, non una storia completa dell’intelligenza artificiale. Gli esperimenti moderni con Bonsai e GLM sono trattati separatamente, senza attribuire ai vecchi modelli risultati misurati su altri checkpoint.
Fonti originali e documentazione
Fonti consultate il 5 ottobre 2026. Le date del modello descrivono l’evento storico; la data dell’articolo indica la pubblicazione su NexastraTech. Le stime di memoria sono calcoli nominali a 2 byte per parametro, in GB decimali, non benchmark o requisiti garantiti.
