📝 Blog

Approfondimenti su prezzi AI cinese, rilasci di modelli e strategie per ottenere l'offerta migliore.
  • Kimi K3 + claude-context: riduci i token del 27% con il recupero semantico del codice

    Un test reale su una base di codice Django mostra che aggiungere claude-context MCP a Kimi K3 riduce i token del 27,1% e le chiamate agli strumenti del 55%, migliorando l'F1 di localizzazione del codice da 0,844 a 0,946.

  • Recensione del piano di token Qwen 3.8 Max: 1,5 miliardi di token per 39 yuan/mese?

    Un test reale del piano di token Qwen 3.8 Max di Alibaba a 39 yuan/mese. L'uso notturno offre circa 1,5 miliardi di token/mese con sconto 0,2x, quello diurno circa 300 milioni con sconto 1x e solo 30 milioni a prezzo pieno. Analisi dei prezzi dell'IA cinese.

  • Gemini 3.6 Flash: 7,50 $, 304 token/s — Perché Google vincerà la corsa all'IA

    Gemini 3.6 Flash eroga 304 token/s a un prezzo di output di soli 7,50 $, superando 3.1 Pro in intelligenza. Con i dati, le riserve di cassa, l'infrastruttura di calcolo e i talenti ineguagliabili di Google, il vincitore finale della corsa all'IA potrebbe essere già deciso.

  • Perché il dibattito sul divieto di Kimi K3 non ha senso — e perché rinforza solo l'IA cinese

    Axios riferisce che l'amministrazione Trump sta valutando di vietare modelli di IA cinesi come Kimi K3 e DeepSeek. Tre motivi per cui non funzionerà: i pesi aperti non possono essere ritirati dalla circolazione, i controlli all'esportazione delle GPU hanno già fallito nel frenare il progresso, e vietare un modello dimostra solo che è abbastanza competitivo da contare.

  • Sfida di generazione di codice con IA: GPT-5.6 Sol vs Kimi K3 vs Qwen3.8Max

    Tre modelli frontier, una sfida di programmazione brutale: generare un sistema solare cinematografico in Three.js e un renderer di città con 50 parametri in un unico file HTML. Scopri chi ha vinto e prova le demo dal vivo.

  • Versione ufficiale di DeepSeek V4: cosa rivelano 121 gray test sulle prestazioni di programmazione

    Abbiamo esaminato 121 video sospettati di essere gray test di DeepSeek V4 da 53 creator, inclusi 40 sessioni di programmazione condivise. Ecco cosa suggeriscono le prove sulla versione ufficiale, i suoi limiti e DeepSeek V4 rispetto a Kimi K3, GPT-5.6 e Fable 5.0.

  • Guida alla quota di Kimi K3: quanto puoi usare? Limiti di 5 ore, settimanali e mensili

    Quanta quota offre davvero l'abbonamento a Kimi K3? Sulla base di dati reali degli utenti Allegretto, stimiamo i limiti di token a 5 ore, 7 giorni e mensili per i piani Andante, Moderato, Allegretto e Allegro, più la quota Kimi Code, i prezzi delle API e il confronto con GPT-5.6 per aiutarti a scegliere il piano giusto.

  • DeepSeek V4 Gray-Release in prova: 12 video e link di condivisione verificabili

    Più utenti segnalano che l'API e l'app web di DeepSeek stanno facendo un gray test di un modello con capacità superiori. Raccolgiamo 6 screenshot hands-on, 4 condivisioni ufficiali della chat DeepSeek, 9 log API di OpenCode e 12 video — e valutiamo quanto bene funziona davvero 'un prompt, un gioco completo'. La versione esatta del modello non è ancora confermata da DeepSeek.

  • Kimi K3 trapelato da una pagina promozionale di ricarica: cosa sappiamo prima del lancio ufficiale

    Moonshot AI ha pubblicato brevemente una pagina promozionale di ricarica di Kimi K3 su platform.kimi.com il 14 luglio 2026 prima di rimuoverla. La fuga conferma il nome K3, suggerisce un lancio imminente (15 luglio – 11 agosto) e rivela bonus di ricarica aggressivi del 10-30%, ma il modello K3 stesso non è ancora disponibile.

  • DeepSeek V4 ufficiale trapelato: supera Claude Opus 4.8 a 1/90 del prezzo

    La versione ufficiale di DeepSeek V4 è trapelata tramite gray release. Tester indipendenti confermano che supera Claude Opus 4.8, collocandosi tra Opus 4.8 e Gemini 2.5 Pro. Può generare giochi 3D completi da un singolo prompt. Il prezzo è 1/90 di quello di Opus. Inclusi 10 test reali su video Bilibili.

  • MiniMax sta costruendo un mostro da 3 biliardi di parametri — e potrebbe cambiare i prezzi dell'IA

    Note interne trapelate rivelano che il modello di nuova generazione di MiniMax punta a 2,5-3 biliardi di parametri e adotta la nuova architettura MSA 2.0, che riduce drasticamente i costi di calcolo. Con l'accesso alle GPU all'estero e una velocità di inferenza di 100 TPS, MiniMax si sta consolidando come il laboratorio frontier più conveniente della Cina.

  • Il mercato dei modelli di IA si sta dividendo in due — ecco come posizionarsi

    I modelli economici stanno diventando infrastruttura. I modelli frontier stanno diventando risorse scarse regolamentate. Il vero valore non è nei modelli — è nello strato di orchestrazione.

  • DeepSeek V4 introduce i prezzi dinamici: le ore di punta costano il doppio

    DeepSeek ha appena annunciato che i prezzi dell'API V4 raddoppieranno durante l'orario lavorativo (9:00–12:00 e 14:00–18:00, ora di Pechino). Il lancio ufficiale di V4 è previsto per metà luglio 2026. Anche alle tariffe di picco, DeepSeek rimane, con largo margine, l'API di IA frontier più economica.

  • Tariffe a fasce orarie di DeepSeek V4: la guida all'arbitraggio delle API IA

    DeepSeek ha appena lanciato la prima tariffa API peak/off-peak al mondo. Le fasce off-peak costano la metà — e grazie ai fusi orari, il peak di qualcuno è sempre l'off-peak di qualcun altro. Ecco come sfruttarlo.

  • 4 strumenti gratuiti per usare GLM 5.2 senza spendere un centesimo

    GLM 5.2 rivaleggia con Claude Sonnet 4 nei benchmark di programmazione. Usalo gratis tramite 4 strumenti cinesi per sviluppatori: ZCode, Trae, Tabbit e CodeBuddy.