La publicación confirma la ruta /v1/chat/completions; no declara características que el contrato no haya documentado.
Moonshot AI
DisponibleKimi K3 en NexoRouter
ID de API: kimi-k3
kimi-k3 es el ID thinking de bandera de Moonshot en NexoRouter. Elígelo para trabajo agentico de contexto largo cuando puedas presupuestar tokens de razonamiento y enviar el string exacto kimi-k3.
- Tipo
- Chat
- Entrada / generación
- $3.04 / 1M tokens
- Salida
- $15.20 / 1M tokens
- Endpoint
/v1/chat/completions
Resumen
kimi-k3 se presenta como un modelo de chat de Moonshot AI. Empieza con una llamada compatible con OpenAI y evalúalo con los prompts, idioma y criterios de calidad de tu propio producto.
El precio mostrado es el precio público aprobado de NexoRouter, no el coste interno ni el descuento del proveedor.
Contexto, tools, benchmark, latencia, TTFT y disponibilidad sólo aparecerán cuando tengan fuente y ventana de medición.
Ficha técnica revisada
kimi-k3 es el ID thinking de bandera de Moonshot en NexoRouter. Elígelo para trabajo agentico de contexto largo cuando puedas presupuestar tokens de razonamiento y enviar el string exacto kimi-k3.
Usa kimi-k3 para bucles de agentes, análisis de contexto largo o apps LatAm en SDK OpenAI que solo necesitan cambiar base_url y model.
Moonshot documenta que Kimi K3 siempre razona y expone reasoning_effort con low, high y max (default max). Los tokens de razonamiento suelen cobrarse como salida: define un max_tokens realista.
Materiales vendor indican que kimi-k2.5 y moonshot-v1 se retiraron el 31 de agosto de 2026. Sustituye esas cadenas tras confirmar que kimi-k3 sigue Available en la ficha NexoRouter.
- Modelo thinking de bandera en el mapeo Moonshot
- Presupuesta salida para reasoning + respuesta
- Reemplaza kimi-k2.5 / moonshot-v1 tras chequear el catálogo
Usa la superficie Chat Completions compatible con OpenAI en https://api.nexorouter.com/v1 con Authorization Bearer y tu clave de NexoRouter.
Envía el campo model con el ID exacto kimi-k3. Los nombres de marketing o el nombre que reporta el vendor no demuestran el enrutamiento de NexoRouter.
Usa los ejemplos de Integración de esta página con tu clave API de NexoRouter y el ID exacto de modelo de arriba. Apunta el SDK de OpenAI a https://api.nexorouter.com/v1, envía Authorization Bearer y copia el public_id de esta ficha en el campo model.
- Base URL: https://api.nexorouter.com/v1
- ID exacto: kimi-k3
- Ruta del endpoint en la ficha: /v1/chat/completions
Los precios unitarios prepago vigentes aparecen en el panel de precios en vivo de esta ficha (entrada, caché y salida). Ese panel es la autoridad para presupuestos y facturación.
NexoRouter cobra en USD prepago por 1M de tokens. No uses tablas fechadas de blog ni tarifas first-party del vendor como tarifa contractual vigente: solo el panel de precios en vivo de esta página es autoritativo.
- Autoridad: panel de precios en vivo de esta página
- Unidad: USD prepago por 1M de tokens
- No presupuestos con tablas de blog fechadas
Moonshot documenta que kimi-k3 siempre razona y expone reasoning_effort con valores low, high y max (por defecto max). Confirma que tu ruta en NexoRouter reenvía esos campos antes de depender de ellos en tool loops multi-turno.
Los tokens de reasoning suelen cobrarse como salida — fija un max_tokens que cubra reasoning más la respuesta final, no un techo de juguete.
Quédate en la superficie pública de Chat Completions verificada en esta ficha. Si un ejemplo vendor muestra un parámetro ausente aquí, trátalo como guía directa de Moonshot hasta que la ficha lo liste.
- Planifica max_tokens para reasoning más respuesta final
- Confirma el reenvío de reasoning_effort / reasoning_content
- Usa solo parámetros mostrados en esta ficha de NexoRouter
Contenido publicado el 9 sept 2026 UTC tras revisión técnica, lingüística y de fuentes. Se muestra únicamente para esta versión e idioma del modelo.
Proveedor y ruta
NexoRouter publica kimi-k3 mediante el mapeo verificado de Moonshot AI que aparece abajo. Este es el contrato de entrega que debe usar el cliente; no promete rutas upstream adicionales.
kimi-k3/v1/chat/completionsDisponibleEl nombre del proveedor describe el mapeo revisado del catálogo. NexoRouter no afirma que exista failover entre varios proveedores para un modelo salvo que se mida y publique por separado.
Precios
Precios públicos por uso para este ID de modelo. La unidad cambia según el endpoint: no todos los modelos se cobran por tokens.
- Entrada / generación
- $3.04 / 1M tokens
- Entrada en caché
- $0.30 / 1M tokens
- Salida
- $15.20 / 1M tokens
Calculadora de coste
Estima una solicitud con el precio público vigente para este ID exacto de modelo.
Es solo una estimación. El uso real, el redondeo, los tokens en caché, los parámetros multimedia y el registro final de facturación determinan el importe cobrado.
Los precios se publican tras revisión comercial. Una actualización de proveedor genera una revisión; nunca expone descuentos, órdenes ni costes internos.
Rendimiento
Las métricas de rendimiento se publican únicamente cuando NexoRouter dispone de suficientes observaciones de producción para este modelo y de una ventana de medición definida.
Los tokens por segundo requieren observaciones de streaming para este ID exacto.
El tiempo de respuesta del gateway no equivale a la latencia de inferencia, por eso no se mezclan.
El TTFT sólo aparece cuando existen timestamps de streaming para una muestra representativa.
No se generan benchmarks ni gráficos con datos de otros proveedores. Estos campos se completarán sólo con mediciones de NexoRouter, tamaño de muestra y ventana temporal.
Actividad
Actividad agregada y respetuosa con la privacidad, calculada desde los logs del gateway de NexoRouter. No se muestran prompts, API keys, identidades ni direcciones IP.
- Intentos en 7 días
- 134
- Tokens en 7 días
- 3.7 M
- Éxito en 7 días
- 98.5%
- Cuota de tokens del catálogo
- 10.2%
La tasa de éxito se calcula con resultados del gateway de NexoRouter para este ID. No es un SLA upstream, una puntuación de calidad ni un benchmark.
Integración
NexoRouter expone este modelo mediante /v1/chat/completions. Usa una API key de NexoRouter y conserva la URL base compatible con OpenAI.
curl --fail-with-body 'https://api.nexorouter.com/v1/chat/completions' \
-H "Authorization: Bearer $NEXOROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "Hola"
}
]
}'Ejemplo de Chat Completions con el ID exacto del modelo. Ajusta mensajes y parámetros a tu caso de uso.
Confirma autenticación, endpoint, formato de request y límites antes de copiar una integración a producción.
Fuentes y actualización
Cada ficha mezcla datos operativos de NexoRouter con enlaces de documentación del proveedor. Un enlace del proveedor no se transforma en una promesa de capacidad hasta que esa afirmación se revisa y publica.
Ruta, disponibilidad y precio público comprobados en el snapshot del catálogo: 27 ago 2026, 12:52 a.m. UTC.
- Documentación oficialGuía reasoning effort de KimiAbrir fuente
- Documentación oficialKimi K3 Quickstart (Moonshot)Abrir fuente
- Documentación oficialLista de modelos Moonshot (IDs retirados)Abrir fuente
- Documentación oficialFicha NexoRouter kimi-k3Abrir fuente
- Catálogo NexoRouterNexoRouter published catalog27 ago 2026, 12:52 a.m.
- Documentación oficialMoonshot AI platform documentationAbrir fuente
Política de actualización: la evidencia de ruta tiene un objetivo de 6 h y el monitor de documentos oficiales, cuando está habilitado en producción, de al menos cada 24 h. Un cambio crea una propuesta interna; las afirmaciones y traducciones requieren revisión humana y se revalidan dentro de 30 días.
Preguntas frecuentes
¿Para qué sirve kimi-k3?
kimi-k3 está publicado para generación de texto y conversación. Pruébalo con los prompts, idioma y criterios de calidad de tu producto.
¿Cuál es el precio de kimi-k3?
El precio público actual es $3.04 / 1M tokens para entrada o generación y $15.20 / 1M tokens para salida. La unidad visible es la unidad de facturación de este endpoint.
¿Cómo se llama este modelo en la API?
Usa exactamente kimi-k3 como ID de modelo y llama a /v1/chat/completions con una API key de NexoRouter.
¿Cómo se factura el uso de este modelo?
NexoRouter registra el uso en la unidad pública del endpoint. Los valores publicados actualmente son $3.04 / 1M tokens para entrada o generación y $15.20 / 1M tokens para salida; la página de facturación sigue siendo el registro contable de la cuenta.
¿Qué fiabilidad tiene este modelo en NexoRouter?
El agregado público actual de siete días cubre 134 intentos con una tasa de éxito del gateway de 98.5%. Es una observación reciente de NexoRouter, no un SLA upstream.
¿Por qué no aparecen benchmarks, contexto o uptime?
No publicamos cifras sin una fuente verificable, método y ventana de medición. Cuando NexoRouter tenga telemetría agregada y documentación de esos campos, se añadirá con su procedencia.