Troppa roba da leggere: DeepSeek ha annunciato che le API di V4 introdurranno una tariffazione dinamica per fasce orarie — nelle ore di punta dei giorni lavorativi (orario di Pechino 9:00–12:00 e 14:00–18:00) i prezzi raddoppiano, mentre nelle fasce di basso traffico restano invariati. Il rilascio stabile di V4 è previsto per metà luglio 2026. Anche calcolando il prezzo di punta raddoppiato, DeepSeek resta l'API AI all'avanguardia più economica al mondo — e non di poco.
⚡ Cosa è successo
Il 29 giugno DeepSeek ha inviato ai propri utenti un'email intitolata «Piano di rilascio della versione stabile di DeepSeek V4 e adeguamento della tariffazione». La novità più grande è la tariffazione dinamica per fasce orarie — una prima assoluta tra i principali provider di API AI.
Durante le ore di punta dei giorni lavorativi (orario di Pechino 9:00–12:00 e 14:00–18:00), tutti i prezzi delle API V4 raddoppiano; nel resto del giorno le tariffe non cambiano e restano ai livelli già ridicolmente bassi di oggi.
Funziona come il surge pricing di Uber all'ora di punta, solo che l'unità di misura sono i token AI. Quando tutti stanno scrivendo codice, paghi un sovrapprezzo; sposti i job batch alle tre di notte? Sconto.
📊 Il listino
DeepSeek V4 Pro
| Voce di tariffazione | Fascia bassa (¥/M token) | Fascia di punta (¥/M token) |
|---|---|---|
| Input (cache hit) | ¥0,025 | ¥0,05 |
| Input (cache miss) | ¥3,00 | ¥6,00 |
| Output | ¥6,00 | ¥12,00 |
DeepSeek V4 Flash
| Voce di tariffazione | Fascia bassa (¥/M token) | Fascia di punta (¥/M token) |
|---|---|---|
| Input (cache hit) | ¥0,02 | ¥0,04 |
| Input (cache miss) | ¥1,00 | ¥2,00 |
| Output | ¥2,00 | ¥4,00 |
📋 Il costo reale
I prezzi unitari non ti dicono nulla? Vediamo una bolletta vera. Qingxiaowa di Appinn ha condiviso i suoi consumi effettivi: usare DeepSeek V4 Flash per aggiornare in automatico un calendario dei mondiali di calcio — risultati, gol, statistiche delle partite — per un mese intero:
- Giorno normale: circa ¥2 (circa $0,28)
- Giorno intenso (bug da correggere, job da rilanciare): ¥13 (circa $1,82)
- Totale di un intero mese: ¥60 (circa $8,40)
Sì — una pipeline che gira in automatico ogni giorno, per un mese intero, costa meno di un pranzo a San Francisco.
🏆 Il confronto con i concorrenti
Qui sotto i prezzi di output dei modelli principali (dollari, per milione di token):
| Modello | Output $/M | Finestra di contesto |
|---|---|---|
| DeepSeek V4 Flash (bassa / punta) | $0,28 / $0,56 | 1.000.000 |
| DeepSeek V4 Pro (bassa / punta) | $0,87 / $1,74 | 1.000.000 |
| Xiaomi MiMo V2.5 | $0,28 | 1.000.000 |
| Xiaomi MiMo V2.5 Pro | $0,87 | 1.000.000 |
| MiniMax M3 | $1,20 | 1.000.000 |
| GLM-5.1 (Zhipu) | $4,40 | 200.000 |
| Kimi K2.6 | ¥27 ≈ $3,78 | 262.000 |
| Qwen3.7 Plus | ¥8 ≈ $1,12 | 1.000.000 |
| GPT-5.5 (OpenAI) | $30,00 | 1.100.000 |
| Claude Opus 4.8 (Anthropic) | $25,00 | 1.000.000 |
Nella fascia «1 milione di contesto + prezzo ultra-basso», il concorrente più vicino è Xiaomi MiMo V2.5 — output a $0,28/M, in parità con il prezzo di bassa di DeepSeek V4 Flash, ma senza sovrapprezzo di punta. Se sei sensibile ai costi e non vuoi impazzire con le fasce orarie, MiMo potrebbe essere una scelta più tranquilla.
🤔 Perché lo fanno
Motivo semplice: gestione della capacità. I server di DeepSeek durante l'orario lavorativo cinese vengono presi d'assalto. Invece di rifiutare richieste (o far degradare la qualità per il sovraccarico), usano il segnale di prezzo per spianare i picchi di domanda.
È economia dell'infrastruttura piuttosto intelligente. AWS e Google Cloud lo fanno da anni — le istanze spot e la capacità prenotata seguono la stessa logica. DeepSeek è semplicemente il primo a portare questo modello nell'inferenza dei language model.
Ci saranno imitatori. Se DeepSeek dimostra che l'approccio funziona, Kimi e Qwen quasi sicuramente lanceranno le proprie fasce orarie.
🎯 Cosa dovresti fare
- Se sei sensibile al prezzo: sposta i carichi pesanti (batch, generazione di dati di training, analisi su larga scala) fuori dall'orario lavorativo di Pechino (9:00–12:00 e 14:00–18:00). Il tuo portafoglio ti ringrazierà.
- Se ti serve disponibilità 7×24: fai budget sul prezzo di punta, oppure costruisci una catena di fallback — in fascia di punta sposti il traffico su MiMo V2.5 o Qwen3.7 Plus, in fascia bassa torni a DeepSeek.
- Se sei un free-rider o hai budget minimi: V4 Flash in fascia bassa è praticamente gratuito. Input (cache miss) a ¥1/M significa che elaborare 1 milione di token in input più 1 milione in output ti costa circa ¥3 (41 centesimi di dollaro). Un intero romanzo lungo: leggerlo, analizzarlo, restituirlo — tutto a questo prezzo.
⏳ In conclusione
Dopo il raddoppio, DeepSeek V4 resta l'API AI all'avanguardia più economica al mondo. La tariffazione a fasce è una feature, non un bug — dimostra che la domanda per DeepSeek è tale da richiedere gestione della capacità, e questo viene dichiarato in modo trasparente nel prezzo.
Se stai usando API AI cinesi (e onestamente dovresti — il divario di prezzo rispetto ai vendor USA è diventato assurdamente insensato), basta che il tuo task non richieda input multimodali: DeepSeek V4 Flash resta la scelta predefinita. Sposta i lavori pesanti dopo cena e amen.
Fonti: email agli utenti di DeepSeek (29 giugno 2026), report di Appinn, catalogo prezzi DevTk.AI. Prezzi verificati il 3 luglio 2026.