Business17 agosto 2026 · 6 min di lettura

DeepSeek alza i prezzi fino a 11 volte: che fare in azienda

Dal 17 agosto DeepSeek aumenta le tariffe API fino all'1.100%. Non è una notizia sui listini: è la prova che un fornitore può cambiarvi i conti in una notte.

In sintesi

  • Da questo fine settimana le API DeepSeek V4-Flash e V4-Pro costano dal 50% all'1.100% in più, con una fascia di punta al doppio della tariffa ridotta.
  • L'input in cache è la voce che cresce di più, fino all'1.100%: è quella che decide il conto di un agente che rilegge lo stesso contesto a ogni richiesta.
  • Il preavviso è stato di due giorni, dato con una riga di changelog. Nessun contratto di fornitura serio si regge su un preavviso così.
  • La tariffa ridotta copre 17 ore su 24: i carichi differibili — anagrafiche, ticket, schede prodotto — si programmano di notte e costano la metà.
  • In Italia su DeepSeek pesa anche il provvedimento del Garante del 30 gennaio 2025, che ha limitato in via d'urgenza il trattamento dei dati degli utenti italiani.

Giovedì 13 agosto DeepSeek ha aggiornato il changelog della propria API. Da questo fine settimana — il 17 agosto secondo il comunicato ripreso da Reuters, il 16 per altre testate, questione di fuso — le tariffe dei modelli V4-Flash e V4-Pro salgono dal 50% all'1.100%, e compare per la prima volta una fascia di punta al doppio della tariffa ordinaria.

Il modello più economico del mercato ha smesso di esserlo in un fine settimana, con quarantotto ore di preavviso date da una riga di changelog. Chi in azienda non ha mai usato DeepSeek può pensare che la cosa non lo riguardi: riguarda invece chiunque abbia messo in produzione un'automazione appoggiata al listino di un fornitore.

Che cosa ha deciso DeepSeek, in cifre

Sul modello leggero, V4-Flash, l'input a cache mancata passa da 0,14 dollari per milione di token a 0,22 fuori punta e 0,44 in fascia piena; l'output da 0,28 a 0,66 e 1,32. Sul V4-Pro l'input va da 0,435 a 0,66 e 1,32, l'output da 0,87 a 1,98 e 3,96.

In percentuale: dal 51% al 214% sugli input, dal 127% al 371% sugli output. La voce che cresce di più è l'input in cache, fra il 52% e l'1.100% — ed è proprio quella su cui si regge il conto di un agente che rilegge lo stesso contesto a ogni richiesta.

L'azienda motiva la decisione con la volontà di «allocare le risorse in modo più ragionevole». Gli analisti citati da InfoWorld e Computerworld leggono la mossa come l'effetto di una domanda che cresce più in fretta della capacità di calcolo. La tariffa ridotta copre 17 ore su 24: la fascia piena è la finestra corta.

Perché riguarda un'azienda che non ha mai sentito nominare DeepSeek?

Per due motivi. Il listino di DeepSeek è il pavimento su cui tutti gli altri appoggiano i propri prezzi: quando si alza, si allarga il margine di manovra di ogni concorrente. E la dinamica — una riga di changelog, due giorni di preavviso, un contratto che cambia — è replicabile da qualunque fornitore.

E quasi nessuna PMI italiana compra token direttamente. Secondo l'Istat, nel 2025 il 16,4% delle imprese con almeno dieci addetti usa intelligenza artificiale contro l'8,2% del 2024, e fra le imprese da 10 a 49 addetti si è al 15,7% contro il 53,1% delle grandi. Quasi tutte comprano un servizio che i token li consuma per loro: un chatbot, un gestionale con la funzione «riassumi», un'agenzia che fa girare i flussi. Il rincaro non arriva sulla bolletta del cloud: arriva al rinnovo, sei mesi dopo, sotto forma di listino aggiornato.

Quanto vi costerebbe cambiare modello domani mattina?

Dipende da una cosa sola: se il nome del modello sta in un punto solo del vostro sistema o in venti. Con un'astrazione — una variabile d'ambiente, un nodo di configurazione, un campo nel pannello — la sostituzione è un pomeriggio di prove. Senza, diventa un progetto.

Il costo di uscita, però, non è quasi mai tecnico. È di verifica. I prompt tarati per mesi su un modello si comportano diversamente su un altro: cambia la lunghezza delle risposte, la propensione a inventare quando il dato non c'è, la resa in italiano sui testi tecnici. La spesa vera è rileggere cento casi reali e decidere se il nuovo comportamento è accettabile. Chi tiene un registro aggiornato degli strumenti in uso — quale modello, in quale flusso, con quali dati — ha già metà del lavoro fatto: è il contenuto della guida sull'inventario degli strumenti AI.

Chi costruisce i flussi con n8n parte avvantaggiato: il modello è un parametro del nodo, non una scelta scolpita nel codice. Per questo, nella guida al primo agente AI, la configurazione del modello sta in un passo separato.

Il caso italiano: c'è anche un provvedimento del Garante

In Italia, su DeepSeek, la questione del prezzo arriva dopo un'altra. Il 30 gennaio 2025 il Garante per la protezione dei dati personali ha disposto in via d'urgenza la limitazione del trattamento dei dati degli utenti italiani nei confronti di Hangzhou DeepSeek Artificial Intelligence e Beijing DeepSeek Artificial Intelligence, aprendo contestualmente un'istruttoria: le due società avevano risposto all'Autorità sostenendo di non operare in Italia e che la normativa europea non fosse loro applicabile.

Le applicazioni sono state rimosse dagli store; il sito è rimasto raggiungibile, tanto che il Garante ha poi scritto all'Associazione Italiana Internet Provider e ai singoli operatori chiedendo «ogni determinazione di propria competenza». La conseguenza per un'impresa italiana è semplice: la scheda di DeepSeek in directory resta quella di uno strumento dal rapporto qualità-prezzo notevole e con i pesi scaricabili, ma il servizio ospitato si discute con il responsabile della protezione dei dati prima che con l'amministrazione. Se il vincolo è il trattamento dentro l'Unione, l'alternativa sul tavolo è un fornitore europeo come Mistral o l'esecuzione dei pesi aperti su un server proprio.

Le ore non di punta sono un risparmio o una trappola?

Sono un risparmio reale, ma solo per il lavoro che può aspettare. La tariffa ridotta copre diciassette ore su ventiquattro, e metà prezzo su un carico notturno è metà prezzo davvero. Arricchire un'anagrafica, classificare i ticket, generare schede prodotto in blocco sono compiti che si programmano. Una risposta a un cliente in chat, no: quella cade quando cade.

La conseguenza operativa è dividere i carichi in due — sincrono e differibile — e trattarli diversamente. Su un orchestratore di flussi è un cambio di trigger, non di architettura, e conviene farlo comunque: la stessa distinzione riduce il conto su qualunque fornitore con lotti scontati.

Che cosa mettere in ordine questa settimana

  1. Il numero giusto. Non il prezzo per milione di token, ma il costo per pratica evasa: quanto costa rispondere a una richiesta di preventivo, classificare una fattura, gestire un ticket. È l'unica cifra confrontabile con la stessa cosa fatta a mano.
  2. Un tetto e un avviso. Quasi tutti i fornitori permettono un limite di spesa mensile e una notifica a metà soglia. Se non sono impostati, il primo segnale del rincaro sarà la fattura.
  3. Il nome del modello in un punto solo. Se compare in più file, più flussi, più prompt, consolidarlo costa mezza giornata e vale come un'assicurazione.
  4. Un secondo modello provato, non solo scelto. Un piano B sulla carta non serve: va fatto girare una settimana in parallelo sul 5% del traffico.
  5. La clausola sul preavviso. Se il servizio lo fornisce qualcun altro, il contratto deve dire quanto preavviso avete su una variazione di prezzo. Due giorni di changelog non sono un preavviso contrattuale.

Il prezzo basso tornerà?

Non c'è ragione di aspettarselo a breve. DeepSeek dichiara di voler allocare le risorse «in modo più ragionevole», che nel linguaggio dei listini significa razionare una capacità che non basta. Finché la domanda cresce più in fretta dei data center, il prezzo per token resta una variabile di mercato, non una costante su cui appoggiare un piano triennale.

Da cui l'unica conclusione utile: il vantaggio di un'impresa non è mai stato usare il modello più economico — quello lo può fare chiunque, e infatti in un fine settimana ha smesso di essere economico. Il vantaggio è avere un processo che funziona e poterlo alimentare con qualunque modello. Il primo è una condizione di mercato, e il mercato se la riprende quando vuole. Il secondo è vostro.

Domande frequenti

Di quanto sono aumentati i prezzi delle API di DeepSeek?

Su V4-Flash l'input a cache mancata passa da 0,14 dollari per milione di token a 0,22 fuori punta e 0,44 in fascia piena, l'output da 0,28 a 0,66 e 1,32. Su V4-Pro l'input va da 0,435 a 0,66 e 1,32, l'output da 0,87 a 1,98 e 3,96. L'input in cache cresce fino all'1.100%.

La mia azienda non usa DeepSeek: devo preoccuparmi lo stesso?

Sì, se avete un'automazione in produzione. Il listino di DeepSeek è il pavimento su cui gli altri fornitori appoggiano i propri prezzi, e la dinamica — due giorni di preavviso su un changelog — è replicabile da chiunque. Il rincaro arriva al rinnovo del servizio, non sulla bolletta del cloud.

Si può usare DeepSeek in Italia?

Il 30 gennaio 2025 il Garante ha disposto in via d'urgenza la limitazione del trattamento dei dati degli utenti italiani nei confronti delle due società DeepSeek, aprendo un'istruttoria; le applicazioni sono state rimosse dagli store. I pesi aperti restano eseguibili su un server proprio: è il servizio ospitato a essere il punto critico.

Come si riduce la dipendenza da un singolo fornitore di modelli?

Tenendo il nome del modello in un punto solo della configurazione, misurando il costo per pratica evasa invece che per token, impostando un tetto di spesa con avviso, e facendo girare un secondo modello in parallelo su una piccola quota di traffico prima che serva davvero.

Fonti

Continua a leggere

Tutti gli articoli →
Ogni giovedì

Tre notizie, un caso d'uso, un tool. Niente altro.

La versione scritta di quello che qui esce durante la settimana, tagliata per chi deve decidere.

Un'email a settimana, disiscrizione con un clic. Informativa privacy.

ELEVIACOM

Serve una mano ad applicarlo davvero?

Progettiamo chatbot, automazioni e agenti AI su misura per PMI italiane. La prima valutazione è gratuita e finisce con un documento, non con un preventivo.