Modelli AI locali / Guida

Vicuna (2023): la nascita dei chatbot della comunità

Storia di Vicuna: sviluppatori, uscita, innovazioni, memoria, limiti e utilità nel 2026. Fonti originali e percorso cronologico.

Mascotte ufficiale Vicuna
LMSYS / Immagine ufficiale del progetto

La tappa storica

LMSYS presentò Vicuna il 30 marzo 2023, inizialmente con una versione 13B basata su LLaMA. L’adattamento sfruttava conversazioni condivise dagli utenti tramite ShareGPT. Il progetto pubblicò strumenti di addestramento, servizio e valutazione nel repository FastChat.

Che cosa cambiò

Il titolo dell’annuncio citava una qualità vicina al 90% di ChatGPT, con un asterisco. La valutazione era preliminare e impiegava GPT-4 come giudice: quel numero non significa “90% di capacità” su ogni lavoro o una prova sul nostro PC. Il codice FastChat era Apache 2.0; i modelli della prima release restavano soggetti ai vincoli della base LLaMA e dei dati, con uso di ricerca non commerciale.

Come leggerlo e provarlo

Il valore storico è vedere come conversazioni e infrastruttura portarono un modello di base verso una chat più naturale. Per valutare un assistente, però, servono criteri distinti: una risposta piacevole può fallire un calcolo, inventare una fonte o produrre codice non eseguibile. Il giudizio di un altro modello è uno strumento di valutazione, non una garanzia indipendente.

Hardware: pesi e memoria totale

Per la versione 13B, i soli pesi a 16 bit valgono nominalmente circa 26 GB. È un calcolo, non un requisito completo né una misura del servizio FastChat. Varianti quantizzate potevano cambiare la distribuzione sul PC, ma occorre distinguere taglia, generazione e formato. Le versioni Vicuna successive non sono identiche al modello annunciato a marzo.

Ha ancora senso nel 2026?

Nel 2026 lo consideriamo una tappa utile per leggere criticamente le classifiche degli assistenti. Se replichi una prova, documenta quale revisione stai usando e prepara domande con esito verificabile. Per il coding esegui il programma; per le fonti apri gli originali. Non trasferire al tuo esperimento il punteggio promozionale dell’annuncio, e non interpretare un buon dialogo come prova di affidabilità generale.

Seguire la storia

Questi sei approfondimenti sono una selezione di tappe fra il 2019 e il 2023, non una storia completa dell’intelligenza artificiale. Gli esperimenti moderni con Bonsai e GLM sono trattati separatamente, senza attribuire ai vecchi modelli risultati misurati su altri checkpoint.

Fonti originali e documentazione

Fonti consultate il 5 ottobre 2026. Le date del modello descrivono l’evento storico; la data dell’articolo indica la pubblicazione su NexastraTech. Le stime di memoria sono calcoli nominali a 2 byte per parametro, in GB decimali, non benchmark o requisiti garantiti.