Dossier interno · Emisfera

GPU — tre richieste separate, e la possibilità di unirle

In questo momento ci sono tre richieste di GPU separate, ognuna intorno ai 350-500 euro al mese. Possono restare tre noleggi distinti, e va benissimo. Oppure, visto che capitano insieme, si può guardare cosa succederebbe a metterle sullo stesso ferro: con la stessa spesa complessiva si arriva a una macchina che da soli nessuno dei tre si prende. Questa pagina mette i numeri per valutarlo, non per decidere al posto di nessuno.
Data17 luglio 2026
BaseMisure giugno-luglio 2026
PrezziDossier 12 giugno
NaturaBase di discussione

01 Perché questa pagina

Lo studio comparativo che circola in questi giorni è un buon lavoro e la sua tesi regge: i modelli a pesi aperti bastano per la quasi totalità dei compiti reali. L'autore lo ha mandato anche a me e ha chiesto un feedback prima della versione ufficiale; gliel'ho mandato, è linkato in fondo.

Lo studio non tocca il costo del ferro. Su quello ci sono misure di giugno e luglio su GPU noleggiate, e un dossier prezzi preparato per Emisfera il 12 giugno.

Nota di trasparenza

Queste pagine sono state prodotte con l'intelligenza artificiale, a partire da prove e listini reali di giugno 2026. Le verifiche sono sommarie: i prezzi delle GPU cambiano in fretta, alcune misure sono di un mese fa e vanno riviste prima di prenderci una decisione sopra. Da leggere come base di discussione, non come istruttoria chiusa.

02 Le tre richieste sul tavolo

Tre esigenze distinte, nello stesso ordine di grandezza.

ChiCosa serveOrdine di spesa
Il laboratorio internoGPU a noleggio per gli assistenti interni~350-500 €/mese
Un partner esternoCapacità per far girare modelli open sui propri carichi~350-500 €/mese
La nuova società di chi scriveGPU a noleggio per staging e test~300-500 €/mese

Nessuna delle tre esigenze ha bisogno delle altre per essere soddisfatta: ognuno può noleggiare la sua macchina e funziona. Capitano nello stesso momento, e sommate valgono circa mille euro al mese di spesa già messa a budget. Su quella cifra si prende un ferro di un'altra categoria.

03 Cosa cambierebbe a metterle insieme

Se le tre spese restano separate, ognuna compra una macchina da 48 GB. Se si sommano, la stessa cifra compra una macchina da 96 GB, che è un salto di categoria e non un semplice risparmio.

  1. La memoria non si somma tra box separati. Due box da 48 GB non fanno 96 GB: fanno due volte 48. Un modello da 70 miliardi di parametri non entra in nessuno dei due, mentre in un box da 96 GB ci sta.
  2. Il listino premia il taglio grosso. Sullo stesso fornitore europeo, un dedicato da 48 GB costa 838 euro al mese e uno da 96 GB ne costa 889: sei per cento in più per il doppio della memoria.
  3. Un box tiene caldo un modello alla volta. Ogni richiesta di un modello diverso lo sfratta e costa mezzo minuto di stallo.
  4. Il carico è a raffica. Su tre macchine ognuna si dimensiona per il proprio picco e resta vuota il resto del tempo; su una sola i picchi si compensano.
  5. La manutenzione si paga per box, non per giga. Tre macchine sono tre volte il lavoro.

Il confronto, in numeri

Tre box separatiUn box condiviso
Configurazione3× 48 GB a canone1× 96 GB dedicato europeo
Costo~1.050 €/mese889 €/mese
Memoria totale144 GB96 GB
Memoria utile a un modello48 GB96 GB
Modello più grande che ci gira~35B70B e oltre
Code3 separate1 condivisa
Macchine da mantenere31
Come leggere la riga scomoda

Tre box separati danno più memoria totale (144 GB contro 96) e su quella riga vincono. Ma la memoria totale non serve se è spezzata in tre pezzi che non si parlano: quello che determina quale modello puoi far girare è la memoria di una singola macchina.

04 Comprare o affittare: il pareggio non è un numero

Alla domanda se convenga comprare le GPU o affittarle non esiste una risposta unica. Il pareggio dipende da quale noleggio metti sull'altro piatto, e cambia di un fattore cinque.

Comprare una scheda pro 48 GB (~6.750 €)
contro…
CanoneSi ripaga in
Dedicato europeo 48 GB838 €/mese~9 mesi
Dedicato europeo 96 GB (ma comprando la 96 GB, ~13-14k)889 €/mese~2 anni
Box 2× RTX 3090 a canone — quello che usiamo oggi350 €/mese~3-4 anni

Contro un noleggio caro, comprare si ripaga entro l'anno. Contro il noleggio economico che stiamo già usando, servono tre o quattro anni — e su quell'orizzonte il ferro è vecchio. Chi cita il pareggio senza dire contro cosa sta citando un numero vuoto.

Vale anche per chi ci propone capacità: un fornitore che le schede le ha già comprate ha il problema opposto, deve riempirle.

L'altra metà: quanti utenti

~0,005 $
Costo cloud per richiesta
~2.500
Richieste/giorno di pareggio
~80
Utenti equivalenti · 48 GB
~230
Utenti equivalenti · 96 GB

L'analisi di giugno conclude che sotto le ~200 utenze stabili il cloud vince. È un dato scomodo ma va detto: a pochi utenti un box dedicato non si ripaga. Il che è un argomento in più per metterle insieme, le utenze, invece che dividerle su tre macchine che restano tutte sotto soglia.

05 La domanda ancora aperta

Il pareggio a ottanta utenti è calcolato sul traffico interattivo, persone che scrivono e aspettano. A quel regime una macchina dedicata passa gran parte della giornata accesa a non fare niente.

Ma su un box a canone fisso il lavoro notturno è gratis: le ore sono già pagate. Un'elaborazione massiva su decine di migliaia di documenti — il caso d'uso dello studio — a consumo si paga, su ferro a canone costa zero.

Il calcolo che manca

Nessuno ha ancora calcolato il pareggio includendo quel lavoro notturno. Se il carico sono venti persone e basta, il noleggio a consumo vince; se sono venti persone più un'elaborazione massiva di notte, il canone fisso ribalta il conto. È il prossimo esperimento, ed è breve.

06 I documenti

GPU per LLM in locale — prezzi acquisto e affitto
Preparato per Emisfera il 12 giugno 2026. Prezzi reali, due scenari, comprare e affittare, con link ai venditori e ai provider. Include elettricità, ore di manutenzione e il grafico del punto di pareggio.
public.giobi.com/emisfera/gpu-prezzi/
Il cervello e il ferro
Il feedback allo studio comparativo, richiesto dall'autore. Mette il suo lavoro (qualità dei modelli) accanto al nostro (costo e messa in esercizio). Contiene anche le riserve metodologiche e i punti dove i nostri numeri danno ragione alle obiezioni, non a noi.
public.giobi.com/llm-local/cervello-e-ferro/
La saga della cache — report tecnico
Per l'area sistemi: cosa comporta davvero far girare un modello su ferro proprio, ricostruito su un caso reale dalla diagnosi sbagliata alla causa vera.
public.giobi.com/llm-local/qwen-cache-saga/

Due strade, entrambe legittime

Da qui si può andare in due direzioni. Ognuno noleggia per conto proprio: semplice, nessun coordinamento, nessuna dipendenza da altri, e si parte domani. Oppure si mette la stessa spesa su una macchina sola: si sblocca un modello che da soli non gira, si spende un po' meno in totale, e in cambio bisogna mettersi d'accordo su chi la gestisce e come si divide.

La seconda apre qualcosa che separati non si fa, ma richiede una mezz'ora insieme e un accordo: ha senso solo se interessa a tutti e tre. Se anche solo uno preferisce andare per conto suo, la prima strada resta buona e non è un ripiego.