Comparativa de precios de API de IA china 2026
Precios de API por uso para más de 20 modelos de IA china: DeepSeek, Kimi, GLM, Qwen, MiniMax y más. Compara costes de entrada/salida por millón de tokens, ventanas de contexto y capacidades.
Comparativa de precios de API de IA china 2026: coste por millón de tokens
¿Integras modelos de IA china vía API? Hemos comparado más de 20 modelos de 10 proveedores lado a lado, incluyendo DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE y Spark. Todos los precios son por millón de tokens (entrada / salida), con ventanas de contexto y etiquetas de capacidad. Actualizado en julio de 2026.
| Modelo | Proveedor | Entrada /M | Salida /M | Contexto | Capacidades | Notas |
|---|---|---|---|---|---|---|
| DeepSeek V4 Pro↗ | DeepSeek | ¥3.00Acierto de caché ¥0.025/M | ¥6.00 | 1M | TextFunction CallingStructured Output | CNYPeak pricing 2x during 9–12 and 14–18 Beijing time; general availability mid-July |
| DeepSeek V4 Flash↗ | DeepSeek | ¥1.00Acierto de caché ¥0.02/M | ¥2.00 | 1M | TextFunction CallingStructured Output | CNYPeak pricing 2x during 9–12 and 14–18 Beijing time |
| MiniMax M3↗ | MiniMax | $0.30 | $1.20 | 1M | TextVisionVideoFunction Calling | USD |
| Kimi K3↗ | Kimi (Moonshot AI) | ¥20.00Acierto de caché ¥2.00/M | ¥100.00 | 1M | TextFunction CallingStructured Output | CNYKimi's flagship model for long-horizon coding and end-to-end knowledge work. Always-on reasoning (reasoning_effort, currently only 'max'). Context caching, tool_choice, and dynamic tool loading supported. Note: web_search is being upgraded — not recommended for now. |
| Kimi K2.6↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextVisionVideoFunction Calling | CNY |
| Kimi K2.5↗ | Kimi (Moonshot AI) | ¥4.00 | ¥21.00 | 262K | TextVisionVideoFunction Calling | CNY |
| Kimi K2.7 Code↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextFunction Calling | CNYReasoning-only mode |
| GLM-5.1↗ | Zhipu AI (GLM) | $1.40 | $4.40 | 200K | TextFunction CallingStructured Output | USD |
| GLM-5 Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextFunction CallingStructured Output | USD |
| GLM-5V Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextVisionVideoFunction CallingStructured Output | USD |
| GLM-5.2↗ | Zhipu AI (GLM) | ¥8.00Acierto de caché ¥2.00/M | ¥28.00 | 1M | TextFunction CallingStructured Output | CNYNewest flagship model. Cache storage limited-time free. |
| Qwen3.7 Max↗ | Alibaba Cloud (Qwen) | ¥12.00 | ¥36.00 | 1M | TextVisionFunction CallingStructured Output | CNY |
| Qwen3.7 Plus↗ | Alibaba Cloud (Qwen) | ¥2.00 | ¥8.00 | 1M | TextVisionFunction CallingStructured Output | CNYContext beyond 256K billed at a separate rate |
| MiMo-V2.5-Pro↗ | Xiaomi (MiMo) | $0.435 | $0.87 | 1M | TextFunction CallingStructured Output | USD (≈¥3.00 / ≈¥6.00)MIT open-source |
| MiMo-V2.5↗ | Xiaomi (MiMo) | $0.14 | $0.28 | 1M | TextVisionVideoAudioFunction Calling | USD (≈¥1.00 / ≈¥2.00)Supports text, image, video, and audio |
| Doubao-Pro↗ | ByteDance (Volcano Engine) | ¥1.00 | ¥2.00 | 128K | TextFunction Calling | CNY |
| Doubao-Lite↗ | ByteDance (Volcano Engine) | ¥0.30 | ¥0.60 | 128K | TextFunction Calling | CNY |
| Hunyuan-Large↗ | Tencent Cloud (Hunyuan) | ¥4.00 | ¥12.00 | 32K | TextFunction Calling | CNY |
| Hunyuan-Standard↗ | Tencent Cloud (Hunyuan) | ¥0.50 | ¥1.00 | 32K | TextFunction Calling | CNY |
| ERNIE 4.5↗ | Baidu (Qianfan) | ¥8.00 | ¥24.00 | 32K | TextFunction Calling | CNY |
| ERNIE Speed↗ | Baidu (Qianfan) | ¥0.12 | ¥0.12 | 8K | TextFunction Calling | CNY |
| Spark 4.0↗ | iFLYTEK (Spark) | ¥3.00 | ¥9.00 | 128K | TextFunction Calling | CNY |
Leyenda de capacidades:TextoVisiónVídeoAudioFunction CallingSalida estructurada
📝 Notas de precios
📌 Notas importantes
• Todos los precios son por millón de tokens (1M = 1.000.000 tokens) a tarifas oficiales por uso. La moneda se indica por proveedor: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash usa pricing de hora punta y valle: en horas punta (09:00-12:00 y 14:00-18:00, hora de Pekín), tanto la entrada como la salida se DOBLAN. Las horas valle están a mitad de precio; el tráfico entre zonas horarias puede aprovecharlo. DeepSeek también soporta caché de contexto: los prefijos de prompt repetidos se facturan a la tarifa de acierto de caché mucho más baja (p. ej., V4 Pro acierto de caché ¥0,025/M frente a fallo ¥3,00/M).
• Qwen3.7 Plus: los precios de entrada/salida anteriores se aplican a los primeros 256K de contexto. El uso por encima de 256K se factura aparte a una tarifa de contexto largo más alta.
• Los precios están sujetos a los anuncios oficiales de cada plataforma. Algunos proveedores ofrecen además descuentos por volumen, paquetes por tramos o créditos de prueba gratis. Verifica siempre antes de integrar.
🔥¿El precio por sí solo no basta?Hemos calculado a la inversa la cuota real de tokens de cada modelo: comprueba cuánto puedes usar de verdad.Ver la comparativa real de cuotas →• Todos los precios son por millón de tokens (1M = 1.000.000 tokens) a tarifas oficiales por uso. La moneda se indica por proveedor: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash usa pricing de hora punta y valle: en horas punta (09:00-12:00 y 14:00-18:00, hora de Pekín), tanto la entrada como la salida se DOBLAN. Las horas valle están a mitad de precio; el tráfico entre zonas horarias puede aprovecharlo. DeepSeek también soporta caché de contexto: los prefijos de prompt repetidos se facturan a la tarifa de acierto de caché mucho más baja (p. ej., V4 Pro acierto de caché ¥0,025/M frente a fallo ¥3,00/M).
• Qwen3.7 Plus: los precios de entrada/salida anteriores se aplican a los primeros 256K de contexto. El uso por encima de 256K se factura aparte a una tarifa de contexto largo más alta.
• Los precios están sujetos a los anuncios oficiales de cada plataforma. Algunos proveedores ofrecen además descuentos por volumen, paquetes por tramos o créditos de prueba gratis. Verifica siempre antes de integrar.