Le basi
Cos'è Quantinia? ▶
Una piattaforma per fare il finetuning ed eseguire modelli AI open-weight sulla tua infrastruttura. Porti i tuoi dati, scegli un modello e lo trasformiamo in uno specialista che possiedi - in esecuzione sul tuo hardware, non affittato a token.
Cosa significa "finetuning" qui? ▶
Il finetuning insegna a un modello base come funziona davvero il tuo settore. Usiamo metodi efficienti - adapter LoRA/QLoRA più SFT e RLVR - piccoli file che specializzano un modello senza riaddestrarlo da zero. Puoi tenere più adapter e scambiarli quando vuoi.
Quali modelli posso usare? ▶
Qualsiasi modello open-weight - Qwen, Llama, Mistral, DeepSeek, Gemma e altri. Scegli quello adatto al tuo compito, al tuo hardware e al tuo budget - compatto per una singola GPU, grande per un cluster.
Devo conoscere il machine learning? ▶
No. Per usare un modello, basta eseguirlo. Per fare il finetuning, fornisci i dati e la pipeline gestisce il resto - oppure, se preferisci, lo facciamo noi per te (vedi il training gestito qui sotto).
Privacy & proprietà
Dove vanno i miei dati? ▶
Da nessuna parte. Il modello gira sulla tua macchina o infrastruttura, quindi i tuoi prompt, documenti e risposte non lasciano mai la tua rete.
Possiedo il risultato? ▶
Sì. Il modello finetuned e gli adapter sono semplici file che possiedi. Tienili interamente in locale, o conservali in un repo privato con controllo degli accessi per la tua organizzazione. Nulla è pubblico a meno che non lo pubblichi tu.
Funziona offline? ▶
Sì. Una volta che il modello è sulla macchina, tutto gira completamente offline - utile per il lavoro regolamentato, i siti remoti, o ovunque i dati non possano lasciare l'edificio.
Hardware
Che GPU mi serve? ▶
Dipende dalla dimensione del modello. Per eseguire un modello compatto, va bene una scheda diffusa. Per fare il finetuning, una scheda da 24 GB (RTX 3090/4090/5090 o Radeon RX 7900 XTX) copre molti modelli; i modelli più grandi vogliono più memoria o un cluster. NVIDIA (CUDA) e AMD (ROCm) sono entrambe di prima classe. Nessuna scheda adatta? Usa il training gestito.
Posso eseguirlo solo su CPU? ▶
Solo per i modelli più piccoli, e lentamente. Per qualcosa di serio serve una GPU per eseguirlo bene - ecco perché esistono le opzioni di training gestito e inference gestita per chi non ne ha una.
Prezzi
Quanto costa? ▶
Piatto e trasparente - gratis per esplorare, una tariffa prevedibile per l'uso privato, e training gestito a prezzo calcolato dal tuo dataset. Non c'è
mai un contatore a token o per postazione. Vedi la pagina
Prezzi per i dettagli.
Come viene calcolato il prezzo del training gestito? ▶
Automaticamente, dal tuo dataset. Lo carichi, ti mostriamo un preventivo esatto prima che parta qualsiasi cosa; approvi, viene addestrato sulle nostre GPU e arriva nel tuo account. I dataset più grandi costano di più in proporzione al tempo GPU che richiedono.
Perché costa meno di un abbonamento frontier? ▶
Perché lo esegui tu stesso. Non ti affittiamo l'intelligenza a token - possiedi il modello e fa il lavoro sul tuo hardware. I modelli frontier fanno lievitare la bolletta con ogni postazione e ogni query; qui il lavoro quotidiano gira in locale e paghi un modello frontier solo per il raro ~1% dei casi davvero difficili.
Per le aziende
Possiamo fare il finetuning sui nostri dati interni? ▶
Sì - è proprio il punto. Parti da un modello open-weight, fai il finetuning sul tuo manuale, codebase, ticket o registri, e tieni privato il modello risultante. I dati grezzi non lasciano mai la tua rete per farlo.
Non abbiamo le GPU o il tempo. Potete farlo voi? ▶
Sì. Oltre al training gestito automatizzato, offriamo consulenza pratica - veniamo, comprendiamo il tuo dominio, costruiamo un dataset coerente e consegniamo un modello funzionante. Molto più economico che assumere e trattenere uno specialista ML.
Come iniziare
C'è una libreria di esempi da cui partire? ▶
Una libreria pubblica di modelli e dataset pubblicati è in arrivo. Per ora, avviamo il tuo progetto da una solida base open-weight e costruiamo insieme a te il modello specializzato.
Mi serve un account? ▶
Solo per contribuire o gestire lavoro privato. Sfogliare e scaricare esempi pubblici non richiede nulla. Un account è solo un'email e una password.