Hardware supportato

Dalla GPU che hai
a un cluster completo.

Non serve un data center per iniziare. Una singola scheda grafica consumer basta per eseguire un modello compatto - e una scheda da 24 GB basta per fare il finetuning del tuo. Scala a più GPU o a un cluster quando ti serve un modello più grande.

Quali schede funzionano

Se ha abbastanza memoria e uno stack di driver supportato, funziona. Le due grandi famiglie di GPU sono coperte.

🟩

NVIDIA

CUDA

RTX 3090, 4090 e 5090 aprono la strada, con il resto della serie RTX 30/40/50 subito dietro - fino alle schede da data center (A100, H100, H200) per i modelli grandi. Il percorso più ampiamente testato.

Addestra & esegui
🟥

AMD

ROCm

Radeon RX 7900 XTX / 7900 XT, con la 7900 XTX da 24 GB come punto ideale, fino agli acceleratori serie Instinct MI. Un percorso di training completo di prima classe.

Addestra & esegui

Cosa puoi fare, per memoria

La VRAM è ciò che conta di più. Eseguire un modello compatto è leggero; farne il finetuning richiede un po' più di margine.

Memoria GPU
Esegui un modello
Fai il finetuning
Schede tipiche
8 GBentry
modelli più piccoli
-
RTX 3060, RX 7600
12-16 GBmainstream
comodo
modelli più piccoli
RTX 4070, RX 7800 XT
24 GBconsigliato
la maggior parte dei modelli
modelli di media dimensione
RTX 4090 / 3090, RX 7900 XTX
48 GB+workstation / cluster
modelli grandi
modelli grandi, multi-GPU
RTX 5090 (x N), A100/H100/H200

QLoRA mantiene bassa la memoria caricando la base in 4-bit. I limiti esatti cambiano con la dimensione del modello e il rank dell'adapter - queste sono linee guida pratiche, non soglie rigide. I modelli più grandi scalano su più GPU o su un cluster.

🐧 Sistema operativo

Linux è il percorso più fluido sia per NVIDIA che per AMD, e Windows funziona tramite WSL. I modelli stessi sono semplici file - non gli importa quale OS li ha creati.

Una buona scheda è tutto il tuo laboratorio di AI.

Se ci puoi giocare a giochi moderni, probabilmente ci puoi fare il finetuning di un modello - e quando ti serve di più, la stessa pipeline gira su un cluster.

Scopri come funziona →
Quantinia
© 2026 Quantinia