Troppa roba da leggere: DeepSeek ha annunciato che le API di V4 introdurranno una tariffazione dinamica per fasce orarie — nelle ore di punta dei giorni lavorativi (orario di Pechino 9:00–12:00 e 14:00–18:00) i prezzi raddoppiano, mentre nelle fasce di basso traffico restano invariati. Il rilascio stabile di V4 è previsto per metà luglio 2026. Anche calcolando il prezzo di punta raddoppiato, DeepSeek resta l'API AI all'avanguardia più economica al mondo — e non di poco.

⚡ Cosa è successo

Il 29 giugno DeepSeek ha inviato ai propri utenti un'email intitolata «Piano di rilascio della versione stabile di DeepSeek V4 e adeguamento della tariffazione». La novità più grande è la tariffazione dinamica per fasce orarie — una prima assoluta tra i principali provider di API AI.

Durante le ore di punta dei giorni lavorativi (orario di Pechino 9:00–12:00 e 14:00–18:00), tutti i prezzi delle API V4 raddoppiano; nel resto del giorno le tariffe non cambiano e restano ai livelli già ridicolmente bassi di oggi.

Funziona come il surge pricing di Uber all'ora di punta, solo che l'unità di misura sono i token AI. Quando tutti stanno scrivendo codice, paghi un sovrapprezzo; sposti i job batch alle tre di notte? Sconto.

📊 Il listino

DeepSeek V4 Pro

Voce di tariffazioneFascia bassa (¥/M token)Fascia di punta (¥/M token)
Input (cache hit)¥0,025¥0,05
Input (cache miss)¥3,00¥6,00
Output¥6,00¥12,00

DeepSeek V4 Flash

Voce di tariffazioneFascia bassa (¥/M token)Fascia di punta (¥/M token)
Input (cache hit)¥0,02¥0,04
Input (cache miss)¥1,00¥2,00
Output¥2,00¥4,00
⚡ Nota: anche al prezzo di punta, l'output di DeepSeek V4 Flash costa solo ¥4/M token, ovvero circa $0,56/M token. Per confronto: GPT-5.5 è a $30/M, Claude Opus 4.8 a $25/M. In altre parole, quando DeepSeek è più caro, resta comunque 45–50 volte più economico del modello di punta di OpenAI.

📋 Il costo reale

I prezzi unitari non ti dicono nulla? Vediamo una bolletta vera. Qingxiaowa di Appinn ha condiviso i suoi consumi effettivi: usare DeepSeek V4 Flash per aggiornare in automatico un calendario dei mondiali di calcio — risultati, gol, statistiche delle partite — per un mese intero:

  • Giorno normale: circa ¥2 (circa $0,28)
  • Giorno intenso (bug da correggere, job da rilanciare): ¥13 (circa $1,82)
  • Totale di un intero mese: ¥60 (circa $8,40)

Sì — una pipeline che gira in automatico ogni giorno, per un mese intero, costa meno di un pranzo a San Francisco.

🏆 Il confronto con i concorrenti

Qui sotto i prezzi di output dei modelli principali (dollari, per milione di token):

ModelloOutput $/MFinestra di contesto
DeepSeek V4 Flash (bassa / punta)$0,28 / $0,561.000.000
DeepSeek V4 Pro (bassa / punta)$0,87 / $1,741.000.000
Xiaomi MiMo V2.5$0,281.000.000
Xiaomi MiMo V2.5 Pro$0,871.000.000
MiniMax M3$1,201.000.000
GLM-5.1 (Zhipu)$4,40200.000
Kimi K2.6¥27 ≈ $3,78262.000
Qwen3.7 Plus¥8 ≈ $1,121.000.000
GPT-5.5 (OpenAI)$30,001.100.000
Claude Opus 4.8 (Anthropic)$25,001.000.000

Nella fascia «1 milione di contesto + prezzo ultra-basso», il concorrente più vicino è Xiaomi MiMo V2.5 — output a $0,28/M, in parità con il prezzo di bassa di DeepSeek V4 Flash, ma senza sovrapprezzo di punta. Se sei sensibile ai costi e non vuoi impazzire con le fasce orarie, MiMo potrebbe essere una scelta più tranquilla.

🤔 Perché lo fanno

Motivo semplice: gestione della capacità. I server di DeepSeek durante l'orario lavorativo cinese vengono presi d'assalto. Invece di rifiutare richieste (o far degradare la qualità per il sovraccarico), usano il segnale di prezzo per spianare i picchi di domanda.

È economia dell'infrastruttura piuttosto intelligente. AWS e Google Cloud lo fanno da anni — le istanze spot e la capacità prenotata seguono la stessa logica. DeepSeek è semplicemente il primo a portare questo modello nell'inferenza dei language model.

Ci saranno imitatori. Se DeepSeek dimostra che l'approccio funziona, Kimi e Qwen quasi sicuramente lanceranno le proprie fasce orarie.

🎯 Cosa dovresti fare

  1. Se sei sensibile al prezzo: sposta i carichi pesanti (batch, generazione di dati di training, analisi su larga scala) fuori dall'orario lavorativo di Pechino (9:00–12:00 e 14:00–18:00). Il tuo portafoglio ti ringrazierà.
  2. Se ti serve disponibilità 7×24: fai budget sul prezzo di punta, oppure costruisci una catena di fallback — in fascia di punta sposti il traffico su MiMo V2.5 o Qwen3.7 Plus, in fascia bassa torni a DeepSeek.
  3. Se sei un free-rider o hai budget minimi: V4 Flash in fascia bassa è praticamente gratuito. Input (cache miss) a ¥1/M significa che elaborare 1 milione di token in input più 1 milione in output ti costa circa ¥3 (41 centesimi di dollaro). Un intero romanzo lungo: leggerlo, analizzarlo, restituirlo — tutto a questo prezzo.
🔮 Previsione: il sovrapprezzo a fasce di DeepSeek V4 è solo il primo segnale. Entro il quarto trimestre 2026 almeno altri due provider AI cinesi seguiranno con tariffe a fasce orarie. L'era dell'«AI a tariffa unica e illimitata» sta finendo — ed è una buona cosa. Significa che l'AI sta diventando vera infrastruttura, non più una demo in perdita per fare rumore.

⏳ In conclusione

Dopo il raddoppio, DeepSeek V4 resta l'API AI all'avanguardia più economica al mondo. La tariffazione a fasce è una feature, non un bug — dimostra che la domanda per DeepSeek è tale da richiedere gestione della capacità, e questo viene dichiarato in modo trasparente nel prezzo.

Se stai usando API AI cinesi (e onestamente dovresti — il divario di prezzo rispetto ai vendor USA è diventato assurdamente insensato), basta che il tuo task non richieda input multimodali: DeepSeek V4 Flash resta la scelta predefinita. Sposta i lavori pesanti dopo cena e amen.


Fonti: email agli utenti di DeepSeek (29 giugno 2026), report di Appinn, catalogo prezzi DevTk.AI. Prezzi verificati il 3 luglio 2026.