Quale modello AI può girare sul tuo PC?
Inserisci il tuo setup e trova modelli scaricabili da provare, con una stima della memoria e il percorso di esecuzione.
Inserisci il tuo setup e scopri da quali modelli partire.
Come vengono scelti i modelli
Il fabbisogno stimato include la dimensione dei file GGUF, la cache del contesto a 16 bit e un margine di esecuzione. Usiamo una richiesta alla volta; per le immagini aggiungiamo il proiettore visivo e un margine più ampio. Le stime sono in GiB: i campi GB seguono l’uso comune delle capacità di RAM e VRAM.
Cache = 2 × layer × teste KV × dimensione della testa × token × 2 byte. Per prudenza conteggiamo una cache piena anche nei modelli con attenzione locale; il programma può consumare meno quando ottimizza queste finestre. Il margine di esecuzione è 0,75–1,5 GiB per il testo e 1,5–3 GiB per una prima prova con immagini, oltre al proiettore.
La preferenza ordina i modelli per taglia e destinazione d’uso; favorisce quelli che entrano nella GPU. Per il percorso misto richiediamo prudentemente spazio in RAM per l’intero carico. Il numero di parametri non è un punteggio di qualità. Driver, versione del programma, batch e immagini possono cambiare il consumo: verifica il primo caricamento. Non stimiamo token al secondo.
Usa llama.cpp con la build adatta al tuo hardware; per le immagini consulta la documentazione multimodale. I download GGUF indicano il relativo editore, anche quando diverso dal creatore del modello.
Catalogo e fonti · 13 modelli · verificato il 6 ottobre 2026
- Qwen3-0.6B · GGUF: bartowski · Architettura
- Qwen3-1.7B · GGUF: bartowski · Architettura
- Qwen3-4B · GGUF: Qwen · Architettura
- Qwen3-8B · GGUF: Qwen · Architettura
- Qwen3-14B · GGUF: Qwen · Architettura
- Qwen3-32B · GGUF: Qwen · Architettura
- Qwen2.5-Coder-1.5B-Instruct · GGUF: Qwen · Architettura
- Qwen2.5-Coder-3B-Instruct · GGUF: Qwen · Architettura
- Qwen2.5-Coder-7B-Instruct · GGUF: Qwen · Architettura
- Qwen2.5-Coder-14B-Instruct · GGUF: Qwen · Architettura
- Phi-4-mini-instruct · GGUF: bartowski · Architettura
- DeepSeek-R1-Distill-Qwen-7B · GGUF: bartowski · Architettura
- gemma-3-4b-it · GGUF: bartowski · Architettura
Il selettore confronta i 13 modelli GGUF elencati nel catalogo. Per altri percorsi: Bonsai e il runtime ternario, CLM e il ragionamento latente, Colibrì e lo streaming da disco, Jev e il servizio di coding. Capire RAM, VRAM e quantizzazione.