Kimi

Moonshot AI

Disponible

Kimi K3 en NexoRouter

ID de API: kimi-k3

kimi-k3 es el ID thinking de bandera de Moonshot en NexoRouter. Elígelo para trabajo agentico de contexto largo cuando puedas presupuestar tokens de razonamiento y enviar el string exacto kimi-k3.

Tipo
Chat
Entrada / generación
$3.04 / 1M tokens
Salida
$15.20 / 1M tokens
Endpoint
/v1/chat/completions
Información verificada

Resumen

kimi-k3 se presenta como un modelo de chat de Moonshot AI. Empieza con una llamada compatible con OpenAI y evalúalo con los prompts, idioma y criterios de calidad de tu propio producto.

Ruta verificadaEndpoint publicado

La publicación confirma la ruta /v1/chat/completions; no declara características que el contrato no haya documentado.

Estado comercialPrecio revisado

El precio mostrado es el precio público aprobado de NexoRouter, no el coste interno ni el descuento del proveedor.

Límite de esta fichaSin métricas inventadas

Contexto, tools, benchmark, latencia, TTFT y disponibilidad sólo aparecerán cuando tengan fuente y ventana de medición.

Revisión editorial

Ficha técnica revisada

kimi-k3 es el ID thinking de bandera de Moonshot en NexoRouter. Elígelo para trabajo agentico de contexto largo cuando puedas presupuestar tokens de razonamiento y enviar el string exacto kimi-k3.

Cuándo elegir este modelo

Usa kimi-k3 para bucles de agentes, análisis de contexto largo o apps LatAm en SDK OpenAI que solo necesitan cambiar base_url y model.

Moonshot documenta que Kimi K3 siempre razona y expone reasoning_effort con low, high y max (default max). Los tokens de razonamiento suelen cobrarse como salida: define un max_tokens realista.

Materiales vendor indican que kimi-k2.5 y moonshot-v1 se retiraron el 31 de agosto de 2026. Sustituye esas cadenas tras confirmar que kimi-k3 sigue Available en la ficha NexoRouter.

  • Modelo thinking de bandera en el mapeo Moonshot
  • Presupuesta salida para reasoning + respuesta
  • Reemplaza kimi-k2.5 / moonshot-v1 tras chequear el catálogo
Cómo llamarlo en NexoRouter

Usa la superficie Chat Completions compatible con OpenAI en https://api.nexorouter.com/v1 con Authorization Bearer y tu clave de NexoRouter.

Envía el campo model con el ID exacto kimi-k3. Los nombres de marketing o el nombre que reporta el vendor no demuestran el enrutamiento de NexoRouter.

Usa los ejemplos de Integración de esta página con tu clave API de NexoRouter y el ID exacto de modelo de arriba. Apunta el SDK de OpenAI a https://api.nexorouter.com/v1, envía Authorization Bearer y copia el public_id de esta ficha en el campo model.

  • Base URL: https://api.nexorouter.com/v1
  • ID exacto: kimi-k3
  • Ruta del endpoint en la ficha: /v1/chat/completions
Precios y unidad de cobro

Los precios unitarios prepago vigentes aparecen en el panel de precios en vivo de esta ficha (entrada, caché y salida). Ese panel es la autoridad para presupuestos y facturación.

NexoRouter cobra en USD prepago por 1M de tokens. No uses tablas fechadas de blog ni tarifas first-party del vendor como tarifa contractual vigente: solo el panel de precios en vivo de esta página es autoritativo.

  • Autoridad: panel de precios en vivo de esta página
  • Unidad: USD prepago por 1M de tokens
  • No presupuestos con tablas de blog fechadas
Límites prácticos

Moonshot documenta que kimi-k3 siempre razona y expone reasoning_effort con valores low, high y max (por defecto max). Confirma que tu ruta en NexoRouter reenvía esos campos antes de depender de ellos en tool loops multi-turno.

Los tokens de reasoning suelen cobrarse como salida — fija un max_tokens que cubra reasoning más la respuesta final, no un techo de juguete.

Quédate en la superficie pública de Chat Completions verificada en esta ficha. Si un ejemplo vendor muestra un parámetro ausente aquí, trátalo como guía directa de Moonshot hasta que la ficha lo liste.

  • Planifica max_tokens para reasoning más respuesta final
  • Confirma el reenvío de reasoning_effort / reasoning_content
  • Usa solo parámetros mostrados en esta ficha de NexoRouter

Contenido publicado el 9 sept 2026 UTC tras revisión técnica, lingüística y de fuentes. Se muestra únicamente para esta versión e idioma del modelo.

Contrato de entrega

Proveedor y ruta

NexoRouter publica kimi-k3 mediante el mapeo verificado de Moonshot AI que aparece abajo. Este es el contrato de entrega que debe usar el cliente; no promete rutas upstream adicionales.

ProveedorID del modeloEndpointEstado
Kimi
Moonshot AI
kimi-k3/v1/chat/completionsDisponible

El nombre del proveedor describe el mapeo revisado del catálogo. NexoRouter no afirma que exista failover entre varios proveedores para un modelo salvo que se mida y publique por separado.

Facturación pública

Precios

Precios públicos por uso para este ID de modelo. La unidad cambia según el endpoint: no todos los modelos se cobran por tokens.

Entrada / generación
$3.04 / 1M tokens
Entrada en caché
$0.30 / 1M tokens
Salida
$15.20 / 1M tokens

Calculadora de coste

Estima una solicitud con el precio público vigente para este ID exacto de modelo.

Total estimadoUSD 0.01

Es solo una estimación. El uso real, el redondeo, los tokens en caché, los parámetros multimedia y el registro final de facturación determinan el importe cobrado.

Los precios se publican tras revisión comercial. Una actualización de proveedor genera una revisión; nunca expone descuentos, órdenes ni costes internos.

Datos medidos, no estimados

Rendimiento

Las métricas de rendimiento se publican únicamente cuando NexoRouter dispone de suficientes observaciones de producción para este modelo y de una ventana de medición definida.

Velocidad de generaciónAún no hay datos verificados suficientes

Los tokens por segundo requieren observaciones de streaming para este ID exacto.

Latencia de extremo a extremoAún no hay datos verificados suficientes

El tiempo de respuesta del gateway no equivale a la latencia de inferencia, por eso no se mezclan.

Tiempo hasta el primer tokenAún no hay datos verificados suficientes

El TTFT sólo aparece cuando existen timestamps de streaming para una muestra representativa.

No se generan benchmarks ni gráficos con datos de otros proveedores. Estos campos se completarán sólo con mediciones de NexoRouter, tamaño de muestra y ventana temporal.

Telemetría agregada de NexoRouter

Actividad

Actividad agregada y respetuosa con la privacidad, calculada desde los logs del gateway de NexoRouter. No se muestran prompts, API keys, identidades ni direcciones IP.

Intentos en 7 días
134
Tokens en 7 días
3.7 M
Éxito en 7 días
98.5%
Cuota de tokens del catálogo
10.2%
17 jul
24 jul
31 jul
7 ago
14 ago
21 ago
28 ago
4 sept

La tasa de éxito se calcula con resultados del gateway de NexoRouter para este ID. No es un SLA upstream, una puntuación de calidad ni un benchmark.

Compatible con OpenAI

Integración

NexoRouter expone este modelo mediante /v1/chat/completions. Usa una API key de NexoRouter y conserva la URL base compatible con OpenAI.

curl --fail-with-body 'https://api.nexorouter.com/v1/chat/completions' \
  -H "Authorization: Bearer $NEXOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "Hola"
    }
  ]
}'

Ejemplo de Chat Completions con el ID exacto del modelo. Ajusta mensajes y parámetros a tu caso de uso.

Trazabilidad

Fuentes y actualización

Cada ficha mezcla datos operativos de NexoRouter con enlaces de documentación del proveedor. Un enlace del proveedor no se transforma en una promesa de capacidad hasta que esa afirmación se revisa y publica.

Snapshot del catálogo público de NexoRouter

Ruta, disponibilidad y precio público comprobados en el snapshot del catálogo: 27 ago 2026, 12:52 a.m. UTC.

  • Documentación oficialGuía reasoning effort de Kimi
    Abrir fuente
  • Documentación oficialKimi K3 Quickstart (Moonshot)
    Abrir fuente
  • Documentación oficialLista de modelos Moonshot (IDs retirados)
    Abrir fuente
  • Documentación oficialFicha NexoRouter kimi-k3
    Abrir fuente
  • Catálogo NexoRouterNexoRouter published catalog
    27 ago 2026, 12:52 a.m.
  • Documentación oficialMoonshot AI platform documentation
    Abrir fuente

Política de actualización: la evidencia de ruta tiene un objetivo de 6 h y el monitor de documentos oficiales, cuando está habilitado en producción, de al menos cada 24 h. Un cambio crea una propuesta interna; las afirmaciones y traducciones requieren revisión humana y se revalidan dentro de 30 días.

Para desarrolladores

Preguntas frecuentes

¿Para qué sirve kimi-k3?

kimi-k3 está publicado para generación de texto y conversación. Pruébalo con los prompts, idioma y criterios de calidad de tu producto.

¿Cuál es el precio de kimi-k3?

El precio público actual es $3.04 / 1M tokens para entrada o generación y $15.20 / 1M tokens para salida. La unidad visible es la unidad de facturación de este endpoint.

¿Cómo se llama este modelo en la API?

Usa exactamente kimi-k3 como ID de modelo y llama a /v1/chat/completions con una API key de NexoRouter.

¿Cómo se factura el uso de este modelo?

NexoRouter registra el uso en la unidad pública del endpoint. Los valores publicados actualmente son $3.04 / 1M tokens para entrada o generación y $15.20 / 1M tokens para salida; la página de facturación sigue siendo el registro contable de la cuenta.

¿Qué fiabilidad tiene este modelo en NexoRouter?

El agregado público actual de siete días cubre 134 intentos con una tasa de éxito del gateway de 98.5%. Es una observación reciente de NexoRouter, no un SLA upstream.

¿Por qué no aparecen benchmarks, contexto o uptime?

No publicamos cifras sin una fuente verificable, método y ventana de medición. Cuando NexoRouter tenga telemetría agregada y documentación de esos campos, se añadirá con su procedencia.

Kimi K3 en NexoRouter | NexoRouter — NexoRouter