Costi4 agosto 2026

Quanto costa davvero l'IA a un team di dodici: il conto

In breve

Per dodici persone che usano un assistente IA a ritmo normale, con una base di conoscenza da 20 GB e trecento esecuzioni di automazione al mese, il conto si ferma attorno ai 35 euro al mese, cioè meno di 3 euro a persona. Caricare i documenti nella base costa altri 69 euro, una volta sola.

Alla domanda su quanto costi l’IA a un’azienda si risponde quasi sempre nella valuta sbagliata. Il fornitore dichiara un prezzo per milione di token. Chi chiede vuole sapere come sarà il mese prossimo per dodici persone. In mezzo c’è una catena di conversioni che nessuno ama fare in pubblico, perché farla significa mostrare le proprie ipotesi.

Eccole allora. Ogni dato di ingresso è dichiarato, e se non è d’accordo con uno, lo sostituisca e rifaccia il conto.

Da dove viene il conto

Cinque cose vengono contate e nient’altro: token in ingresso, token in uscita, interrogazioni di ricerca sul web, secondi di sandbox quando gira del codice e archiviazione dei documenti. Non c’è alcun canone per postazione. Chi non ha aperto l’assistente questo mese non costa nulla.

Sembra un dettaglio contabile. In pratica cambia la forma dell’intera spesa. Con le licenze per postazione si pagano sessanta account di cui venti servono davvero. A consumo si pagano i venti, e finisce la discussione trimestrale su a chi togliere la licenza.

Le tariffe dietro i numeri

Classe di modelloModelloIngresso per 1M di tokenUscita per 1M di token
Economicogemma-4-26b-a4b-it0,40 EUR0,80 EUR
Equilibratoqwen3.5-397b-a17b0,96 EUR5,76 EUR
Il più potenteglm-5.23,24 EUR9,90 EUR

Ci si aggiungono la ricerca sul web a 0,0012 EUR per interrogazione, l’archiviazione a circa 0,019 EUR per gigabyte al mese e l’indicizzazione a 0,16 EUR per milione di token quando i documenti vengono letti.

Guardi il rapporto fra uscita e ingresso nella classe equilibrata: sei a uno. È il numero più importante qui, e ci tornerò.

Le ipotesi sui consumi

Di solito è qui che comincia il tirare a indovinare. Questi numeri vengono da misure su una piattaforma in esercizio e non dal calcolatore di un fornitore:

OperazioneToken in ingressoToken in uscita
Una risposta fondata sui documenti in una conversazione1300350
Una chiamata di supporto, per esempio riscrivere la domanda900250
Un passaggio recuperato nel contesto4100
Un passo di automazione48001100

Perché 1.300 token in ingresso per una domanda di dieci parole? Perché quello che arriva al modello è un’istruzione di sistema, la conversazione fino a quel punto e sei passaggi di documenti. La domanda in sé è un errore di arrotondamento. Chi stima il costo dell’IA dalla lunghezza del prompt sbaglia di due ordini di grandezza.

Dodici persone, un mese

Il profilo: dodici persone, quindici messaggi ciascuna per giorno lavorativo, ventuno giorni lavorativi, il modello equilibrato, il sessanta per cento delle conversazioni fondate sulla base di conoscenza, duecento ricerche sul web, trecento esecuzioni di automazione, venti gigabyte di documenti.

VoceAl mese
Conversazionicirca 27 EUR
Passaggi recuperati nel contestocirca 5 EUR
Ricerca sul webmeno di 1 EUR
Automazioni, 300 esecuzionicirca 3 EUR
Archiviazione, 20 GBcirca 0,40 EUR
Totalecirca 35 EUR

Meno di 3 euro a persona al mese. Per confronto, una licenza per postazione presso un fornitore che fattura a testa parte da circa 20 o 30 euro a persona al mese, usata o no. Con dodici persone la differenza è di circa 250 o 350 euro al mese, diciamo dieci volte tanto.

Prima che suoni troppo bello: un team che si appoggia molto all’IA cambia la forma del conto. Quaranta messaggi al giorno a persona invece di quindici portano la voce delle conversazioni da 27 a circa 72 euro. Ancora più economico delle licenze, ma il divario smette di essere di dieci volte.

Che cosa il numero esclude

L’indicizzazione iniziale. Venti gigabyte di testo sono circa 430 milioni di token da elaborare durante l’indicizzazione, all’incirca 69 euro, pagati una volta. Se la base cresce di due gigabyte al mese, si aggiungano circa 7 euro al mese.

Esclude anche le persone. Introdurre tutto questo, scegliere quali documenti far entrare, impostare i permessi e insegnare a un team a usarlo costa più della piattaforma nel primo anno. Mettere a budget solo le licenze rende sgradevole la conversazione successiva.

Tre leve che tagliano davvero il conto

Risposte più brevi. L’uscita costa sei volte l’ingresso. Un’istruzione di sistema che chiede sintesi può togliere dal conto una percentuale a due cifre senza perdita di utilità.

Meno passaggi nel contesto. Sei passaggi da 410 token fanno 2.460 token in ingresso per risposta. Scendere a quattro fa risparmiare circa un quinto della voce delle conversazioni, e la differenza si sente solo sulle domande davvero ampie.

Adattare la classe di modello al lavoro. Riscrivere una nota o classificare un ticket non richiede il modello più potente. A parità di token consumati, la classe economica costa otto volte meno in ingresso e dodici volte meno in uscita. La maggior parte del denaro che le aziende sprecano qui non dipende dal fatto che l’IA sia cara, ma dal fatto che tutto finisce sul modello più costoso disponibile.

Verificarlo con i propri numeri

Il calcolatore nella pagina dei prezzi esegue esattamente questo conto e lascia cambiare ogni variabile: persone, intensità, classe di modello, dimensione della base di conoscenza, ricerche ed esecuzioni di automazione. Il risultato è una stima e non un’offerta commerciale, ma i dati di ingresso sono reali e vengono dalla stessa tabella su cui si basa la fatturazione.

Una domanda su un pilota, sulla sicurezza o su un'integrazione.

Risponde qualcuno che conosce il codice, di solito nella stessa giornata lavorativa.