Documentación
Elige entre modelos desarrollados en China y modelos globales en la documentación de NexoRouter.
Elige entre modelos desarrollados en China y modelos globales
NexoRouter ofrece familias desarrolladas en China y modelos globales mediante la misma interfaz compatible con OpenAI. La elección correcta depende de la carga de trabajo, no de la etiqueta del país.
Usa el catálogo actual y un conjunto de pruebas controlado para comparar calidad, costo, latencia y disponibilidad antes de enviar tráfico de producción.
Empieza con datos verificados
Para cada candidato:
- Confirma que aparece en Modelos o en
GET /v1/models. - Copia el ID exacto de NexoRouter.
- Abre la ficha y revisa unidad de cobro, tarifas publicadas, capacidades y fuente oficial del proveedor.
- Confirma que el alcance de la API key permite ese modelo.
- Ejecuta el mismo conjunto pequeño de pruebas y revisa Usage Logs.
No dependas de una hoja de cálculo antigua, una captura, una publicación social o un alias del proveedor. Los IDs, funciones, disponibilidad y tarifas pueden cambiar.
Crea una lista corta útil
| Carga de trabajo | Qué comparar |
|---|---|
| Soporte al cliente en español | Seguimiento de instrucciones, español latinoamericano, latencia y costo de salida |
| Extracción y clasificación | Consistencia estructurada, costo de respuestas cortas y tasa de error |
| Código y agentes | Tool calling, contexto, reintentos y calidad de finalización |
| Documentos largos | Límite de contexto, precio de entrada y timeouts |
| Imagen, video o audio | Endpoint, formato de entrada, unidad de cobro y flujo asíncrono |
Familias desarrolladas en China como DeepSeek, Qwen, Kimi y GLM pueden añadir opciones útiles de costo y capacidad. No son automáticamente más baratas, seguras o mejores para cada caso. Compara las tarifas publicadas por NexoRouter y el resultado de tu propio conjunto de pruebas.
Consulta el catálogo actual
curl https://api.nexorouter.com/v1/models \
-H "Authorization: Bearer $NEXOROUTER_API_KEY"
Guarda el ID seleccionado en configuración:
NEXOROUTER_MODEL=exact-model-id-from-the-catalog
Los IDs distinguen mayúsculas y minúsculas.
Ejecuta una evaluación repetible
Crea de 20 a 50 prompts representativos. Incluye solicitudes normales, casos ambiguos, entradas largas y fallos esperados.
Mantén constantes:
- Instrucción de sistema.
- Prompt del usuario.
temperature.max_tokens.- Timeout y política de reintentos.
Registra:
- Cumplimiento de la tarea.
- Calidad de respuesta.
- Tokens de entrada y salida.
- Costo mostrado en Usage Logs.
- Latencia y status.
- Request ID de llamadas fallidas.
No declares un ganador con un solo prompt.
Pasa a producción de forma segura
- Valida la integración con un modelo de bajo costo.
- Prueba la lista corta con los mismos prompts.
- Crea una key dedicada con budget y alcance de modelos.
- Envía primero un porcentaje pequeño del tráfico.
- Supervisa Usage Logs y la tasa de error.
- Mantén un fallback revisado solo si tu aplicación tolera diferencias de salida.