Moonshot AI

Kimi K3

Modelo insignia de Kimi con 2,8 billones de parámetros, visión nativa y contexto de 1 millón de tokens

Kimi K3 es el modelo insignia más capaz de Moonshot AI. Cuenta con 2,8 billones de parámetros, Kimi Delta Attention, Attention Residuals, una arquitectura MoE dispersa, visión nativa y una ventana de contexto de hasta 1.048.576 tokens. Está orientado a programación de largo recorrido, trabajo intensivo en conocimiento y razonamiento, con llamadas a herramientas, salida estructurada, Partial Mode y caché automática de contexto.

Contexto de 1.048.576 tokens1M
Lanzamiento2026-07-17
Gateways27 sitios
2,8 billones de parámetrosVisión nativaProgramación de largo recorridoTrabajo intensivo en conocimientoRazonamientoUso de herramientasContexto de 1 millón

Precios oficiales de Moonshot AI

CNY
Actualizado: 2026-07-17T10:50:25.324+08:00Fuente

Entrada

¥20/ 1M tokens

Precio oficial único sin tramos por longitud de contexto: 20 CNY de entrada sin caché, 2 CNY de entrada en caché y 100 CNY de salida por millón de tokens. La ventana de contexto es de 1.048.576 tokens.

Salida

¥100/ 1M tokens

Precio oficial único sin tramos por longitud de contexto: 20 CNY de entrada sin caché, 2 CNY de entrada en caché y 100 CNY de salida por millón de tokens. La ventana de contexto es de 1.048.576 tokens.

Lectura de caché

¥2/ 1M tokens

Precio oficial único sin tramos por longitud de contexto: 20 CNY de entrada sin caché, 2 CNY de entrada en caché y 100 CNY de salida por millón de tokens. La ventana de contexto es de 1.048.576 tokens.

Precio oficial único sin tramos por longitud de contexto: 20 CNY de entrada sin caché, 2 CNY de entrada en caché y 100 CNY de salida por millón de tokens. La ventana de contexto es de 1.048.576 tokens.

Comparación de gateways

Compara precios por token, solicitud o segundo en cada canal del gateway.

¿Cómo se comparan los precios de gateways para Kimi K3?

Esta página de Kimi K3 compara los precios oficiales con las ofertas públicas de 27 gateways de IA. Los tokens se muestran en CNY por 1 M y las solicitudes, segundos y caracteres usan la unidad de la tabla. Actualizado: 25/07/2026, 10:12.

Fuentes de datos
Catálogos públicos de precios, tarifas oficiales y resultados de seguimiento.
Definición de métricas
La disponibilidad es la tasa de pruebas correctas, la incoherencia indica el riesgo de otro modelo o una respuesta anómala y la latencia es el tiempo medio de respuesta de la API.
Aviso de riesgo
Los gateways son servicios de terceros. Los precios, la facturación, la privacidad y la estabilidad pueden cambiar; empieza con un saldo pequeño y verifica la fiabilidad.