📝 Blog

Análisis en profundidad de precios de IA china, lanzamientos de modelos y estrategias para conseguir el mejor precio.
  • Kimi K3 + claude-context: reduce el consumo de tokens un 27 % con recuperación semántica de código

    Una prueba real sobre una base de código Django muestra que añadir claude-context MCP a Kimi K3 reduce el consumo de tokens un 27,1 % y las llamadas a herramientas un 55 %, al tiempo que mejora el F1 de localización de código de 0,844 a 0,946.

  • Análisis del Plan de tokens Qwen 3.8 Max: ¿1.500 millones de tokens por 39 yuanes/mes?

    Una prueba real del Plan de tokens Qwen 3.8 Max de Alibaba a 39 yuanes/mes. El uso nocturno ofrece ~1.500 millones de tokens/mes con un descuento del 0,2x, el diurno ~300 millones con descuento 1x y solo 30 millones a precio completo. Análisis de precios de la IA de China.

  • Gemini 3.6 Flash: 7,50 $, 304 tokens/s — Por qué Google ganará la carrera de IA

    Gemini 3.6 Flash ofrece 304 tokens/s a un precio de salida de solo 7,50 $, superando a 3.1 Pro en inteligencia. Con los datos, reservas de cash, infraestructura de cómputo y talento inigualables de Google, el ganador final de la carrera de IA podría ya estar decidido.

  • Por qué el debate sobre la prohibición de Kimi K3 no tiene sentido — y por qué solo fortalece a la IA de China

    Axios informa de que la administración Trump estudia prohibir modelos de IA chinos como Kimi K3 y DeepSeek. Tres razones por las que no funcionará: los pesos abiertos no pueden retirarse de circulación, los controles de exportación de GPU ya fracasaron al frenar el progreso, y prohibir un modelo solo demuestra que es lo bastante competitivo como para importar.

  • Duelo de generación de código con IA: GPT-5.6 Sol vs Kimi K3 vs Qwen3.8Max

    Tres modelos frontier, un desafío de programación brutal: generar un sistema solar cinemático en Three.js y un renderizador de ciudad con 50 parámetros en un único archivo HTML. Descubre quién ganó y prueba las demos en vivo.

  • Versión oficial de DeepSeek V4: lo que revelan 121 gray tests sobre el rendimiento en programación

    Hemos revisado 121 vídeos sospechosos de ser gray tests de DeepSeek V4 de 53 creadores, incluidas 40 sesiones de programación compartidas. Esto es lo que sugieren las pruebas sobre la versión oficial, sus límites y DeepSeek V4 frente a Kimi K3, GPT-5.6 y Fable 5.0.

  • Guía de cuota de Kimi K3: ¿cuánto puedes usar? Límites de 5 h, semanales y mensuales

    ¿Cuánta cuota ofrece realmente la suscripción de Kimi K3? A partir de datos reales de usuarios de Allegretto, estimamos los límites de tokens a 5 horas, 7 días y mensuales para los planes Andante, Moderato, Allegretto y Allegro, además de la cuota de Kimi Code, los precios de la API y una comparación con GPT-5.6 para ayudarte a elegir el plan adecuado.

  • DeepSeek V4 Gray-Release en pruebas: 12 vídeos y enlaces para compartir verificables

    Varios usuarios informan de que la API y la aplicación web de DeepSeek están haciendo un gray test de un modelo de mayor capacidad. Reunimos 6 capturas de pantalla, 4 comparticiones oficiales de chat de DeepSeek, 9 registros de la API de OpenCode y 12 vídeos, y evaluamos cómo funciona de verdad «un prompt, un juego completo». DeepSeek aún no ha confirmado la versión exacta del modelo.

  • Kimi K3 filtrado desde una página de recarga promocional: lo que sabemos antes del lanzamiento oficial

    Moonshot AI publicó brevemente una página de recarga promocional de Kimi K3 en platform.kimi.com el 14 de julio de 2026 antes de retirarla. La filtración confirma el nombre K3, sugiere un lanzamiento inminente (15 de julio – 11 de agosto) y revela bonos de recarga agresivos del 10-30 %, pero el modelo K3 en sí aún no está disponible.

  • DeepSeek V4 oficial filtrado: supera a Claude Opus 4.8 por 1/90 del precio

    La versión oficial de DeepSeek V4 se ha filtrado mediante un gray release. Testers independientes confirman que supera a Claude Opus 4.8 y se sitúa entre Opus 4.8 y Gemini 2.5 Pro. Puede generar juegos 3D completos a partir de un único prompt. El precio es 1/90 del de Opus. Incluye 10 pruebas reales en vídeo de Bilibili.

  • MiniMax está construyendo un monstruo de 3 billones de parámetros — y podría cambiar los precios de la IA

    Notas internas filtradas revelan que el modelo de nueva generación de MiniMax apunta a 2,5-3 billones de parámetros y adopta la nueva arquitectura MSA 2.0, que reduce drásticamente el coste de cómputo. Con acceso a GPU en el extranjero y una velocidad de inferencia de 100 TPS, MiniMax se está consolidando como el laboratorio frontier más rentable de China.

  • El mercado de modelos de IA se está dividiendo en dos — así puedes posicionarte

    Los modelos baratos se están convirtiendo en infraestructura. Los modelos frontier se están convirtiendo en recursos escasos regulados. El valor real no está en los modelos — está en la capa de orquestación.

  • DeepSeek V4 introduce precios por franja horaria: las horas punta cuestan el doble

    DeepSeek acaba de anunciar que los precios de la API V4 se duplicarán durante el horario laboral (9:00–12:00 y 14:00–18:00, hora de Pekín). El lanzamiento oficial de V4 está previsto para mediados de julio de 2026. Incluso con tarifas de hora punta, DeepSeek sigue siendo, con gran diferencia, la API de IA frontier más barata.

  • Tarifas por franja horaria de DeepSeek V4: la guía definitiva de arbitraje de API IA

    DeepSeek acaba de lanzar la primera tarifa API con horario punta/no punta del mundo. La franja no punta cuesta la mitad — y gracias a las zonas horarias, el horario punta de unos siempre es el no punta de otros. Te explicamos cómo aprovecharlo.

  • 4 herramientas gratuitas para usar GLM 5.2 sin gastar un céntimo

    GLM 5.2 rivaliza con Claude Sonnet 4 en los benchmarks de programación. Úsalo gratis a través de 4 herramientas chinas para desarrolladores: ZCode, Trae, Tabby y CodeBuddy.