Comparativa de precios de API de IA china 2026

Precios de API por uso para más de 20 modelos de IA china: DeepSeek, Kimi, GLM, Qwen, MiniMax y más. Compara costes de entrada/salida por millón de tokens, ventanas de contexto y capacidades.
📅 Actualización continua · 2026🏷️ 10 proveedores · 20 modelos📌 Última actualización: 4 de julio de 2026

Comparativa de precios de API de IA china 2026: coste por millón de tokens

¿Integras modelos de IA china vía API? Hemos comparado más de 20 modelos de 10 proveedores lado a lado, incluyendo DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE y Spark. Todos los precios son por millón de tokens (entrada / salida), con ventanas de contexto y etiquetas de capacidad. Actualizado en julio de 2026.

22 modelos
ModeloProveedorEntrada /MSalida /MContextoCapacidadesNotas
DeepSeek V4 ProDeepSeek¥3.00Acierto de caché ¥0.025/M¥6.001M
TextFunction CallingStructured Output
CNYPeak pricing 2x during 9–12 and 14–18 Beijing time; general availability mid-July
DeepSeek V4 FlashDeepSeek¥1.00Acierto de caché ¥0.02/M¥2.001M
TextFunction CallingStructured Output
CNYPeak pricing 2x during 9–12 and 14–18 Beijing time
MiniMax M3MiniMax$0.30$1.201M
TextVisionVideoFunction Calling
USD
Kimi K3Kimi (Moonshot AI)¥20.00Acierto de caché ¥2.00/M¥100.001M
TextFunction CallingStructured Output
CNYKimi's flagship model for long-horizon coding and end-to-end knowledge work. Always-on reasoning (reasoning_effort, currently only 'max'). Context caching, tool_choice, and dynamic tool loading supported. Note: web_search is being upgraded — not recommended for now.
Kimi K2.6Kimi (Moonshot AI)¥6.50¥27.00262K
TextVisionVideoFunction Calling
CNY
Kimi K2.5Kimi (Moonshot AI)¥4.00¥21.00262K
TextVisionVideoFunction Calling
CNY
Kimi K2.7 CodeKimi (Moonshot AI)¥6.50¥27.00262K
TextFunction Calling
CNYReasoning-only mode
GLM-5.1Zhipu AI (GLM)$1.40$4.40200K
TextFunction CallingStructured Output
USD
GLM-5 TurboZhipu AI (GLM)$1.20$4.00200K
TextFunction CallingStructured Output
USD
GLM-5V TurboZhipu AI (GLM)$1.20$4.00200K
TextVisionVideoFunction CallingStructured Output
USD
GLM-5.2Zhipu AI (GLM)¥8.00Acierto de caché ¥2.00/M¥28.001M
TextFunction CallingStructured Output
CNYNewest flagship model. Cache storage limited-time free.
Qwen3.7 MaxAlibaba Cloud (Qwen)¥12.00¥36.001M
TextVisionFunction CallingStructured Output
CNY
Qwen3.7 PlusAlibaba Cloud (Qwen)¥2.00¥8.001M
TextVisionFunction CallingStructured Output
CNYContext beyond 256K billed at a separate rate
MiMo-V2.5-ProXiaomi (MiMo)$0.435$0.871M
TextFunction CallingStructured Output
USD (≈¥3.00 / ≈¥6.00)MIT open-source
MiMo-V2.5Xiaomi (MiMo)$0.14$0.281M
TextVisionVideoAudioFunction Calling
USD (≈¥1.00 / ≈¥2.00)Supports text, image, video, and audio
Doubao-ProByteDance (Volcano Engine)¥1.00¥2.00128K
TextFunction Calling
CNY
Doubao-LiteByteDance (Volcano Engine)¥0.30¥0.60128K
TextFunction Calling
CNY
Hunyuan-LargeTencent Cloud (Hunyuan)¥4.00¥12.0032K
TextFunction Calling
CNY
Hunyuan-StandardTencent Cloud (Hunyuan)¥0.50¥1.0032K
TextFunction Calling
CNY
ERNIE 4.5Baidu (Qianfan)¥8.00¥24.0032K
TextFunction Calling
CNY
ERNIE SpeedBaidu (Qianfan)¥0.12¥0.128K
TextFunction Calling
CNY
Spark 4.0iFLYTEK (Spark)¥3.00¥9.00128K
TextFunction Calling
CNY
Leyenda de capacidades:TextoVisiónVídeoAudioFunction CallingSalida estructurada

📝 Notas de precios

📌 Notas importantes
• Todos los precios son por millón de tokens (1M = 1.000.000 tokens) a tarifas oficiales por uso. La moneda se indica por proveedor: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash usa pricing de hora punta y valle: en horas punta (09:00-12:00 y 14:00-18:00, hora de Pekín), tanto la entrada como la salida se DOBLAN. Las horas valle están a mitad de precio; el tráfico entre zonas horarias puede aprovecharlo. DeepSeek también soporta caché de contexto: los prefijos de prompt repetidos se facturan a la tarifa de acierto de caché mucho más baja (p. ej., V4 Pro acierto de caché ¥0,025/M frente a fallo ¥3,00/M).
• Qwen3.7 Plus: los precios de entrada/salida anteriores se aplican a los primeros 256K de contexto. El uso por encima de 256K se factura aparte a una tarifa de contexto largo más alta.
• Los precios están sujetos a los anuncios oficiales de cada plataforma. Algunos proveedores ofrecen además descuentos por volumen, paquetes por tramos o créditos de prueba gratis. Verifica siempre antes de integrar.
🔥¿El precio por sí solo no basta?Hemos calculado a la inversa la cuota real de tokens de cada modelo: comprueba cuánto puedes usar de verdad.Ver la comparativa real de cuotas →