🧠
Modelli AI locali / Calcolatore

Quale modello AI può girare sul tuo PC?

Inserisci il tuo setup e trova modelli scaricabili da provare, con una stima della memoria e il percorso di esecuzione.

Memoria disponibile e formato

I valori iniziali sono un esempio. Il calcolo avviene sul tuo dispositivo.

Inserisci il tuo setup e scopri da quali modelli partire.

Come vengono scelti i modelli

Il fabbisogno stimato include la dimensione dei file GGUF, la cache del contesto a 16 bit e un margine di esecuzione. Usiamo una richiesta alla volta; per le immagini aggiungiamo il proiettore visivo e un margine più ampio. Le stime sono in GiB: i campi GB seguono l’uso comune delle capacità di RAM e VRAM.

Cache = 2 × layer × teste KV × dimensione della testa × token × 2 byte. Per prudenza conteggiamo una cache piena anche nei modelli con attenzione locale; il programma può consumare meno quando ottimizza queste finestre. Il margine di esecuzione è 0,75–1,5 GiB per il testo e 1,5–3 GiB per una prima prova con immagini, oltre al proiettore.

La preferenza ordina i modelli per taglia e destinazione d’uso; favorisce quelli che entrano nella GPU. Per il percorso misto richiediamo prudentemente spazio in RAM per l’intero carico. Il numero di parametri non è un punteggio di qualità. Driver, versione del programma, batch e immagini possono cambiare il consumo: verifica il primo caricamento. Non stimiamo token al secondo.

Usa llama.cpp con la build adatta al tuo hardware; per le immagini consulta la documentazione multimodale. I download GGUF indicano il relativo editore, anche quando diverso dal creatore del modello.

Catalogo e fonti · 13 modelli · verificato il 6 ottobre 2026

Il selettore confronta i 13 modelli GGUF elencati nel catalogo. Per altri percorsi: Bonsai e il runtime ternario, CLM e il ragionamento latente, Colibrì e lo streaming da disco, Jev e il servizio di coding. Capire RAM, VRAM e quantizzazione.