Documentación

Elige entre modelos desarrollados en China y modelos globales en la documentación de NexoRouter.

Elige entre modelos desarrollados en China y modelos globales

NexoRouter ofrece familias desarrolladas en China y modelos globales mediante la misma interfaz compatible con OpenAI. La elección correcta depende de la carga de trabajo, no de la etiqueta del país.

Usa el catálogo actual y un conjunto de pruebas controlado para comparar calidad, costo, latencia y disponibilidad antes de enviar tráfico de producción.

Empieza con datos verificados

Para cada candidato:

  1. Confirma que aparece en Modelos o en GET /v1/models.
  2. Copia el ID exacto de NexoRouter.
  3. Abre la ficha y revisa unidad de cobro, tarifas publicadas, capacidades y fuente oficial del proveedor.
  4. Confirma que el alcance de la API key permite ese modelo.
  5. Ejecuta el mismo conjunto pequeño de pruebas y revisa Usage Logs.

No dependas de una hoja de cálculo antigua, una captura, una publicación social o un alias del proveedor. Los IDs, funciones, disponibilidad y tarifas pueden cambiar.

Crea una lista corta útil

Carga de trabajoQué comparar
Soporte al cliente en españolSeguimiento de instrucciones, español latinoamericano, latencia y costo de salida
Extracción y clasificaciónConsistencia estructurada, costo de respuestas cortas y tasa de error
Código y agentesTool calling, contexto, reintentos y calidad de finalización
Documentos largosLímite de contexto, precio de entrada y timeouts
Imagen, video o audioEndpoint, formato de entrada, unidad de cobro y flujo asíncrono

Familias desarrolladas en China como DeepSeek, Qwen, Kimi y GLM pueden añadir opciones útiles de costo y capacidad. No son automáticamente más baratas, seguras o mejores para cada caso. Compara las tarifas publicadas por NexoRouter y el resultado de tu propio conjunto de pruebas.

Consulta el catálogo actual

curl https://api.nexorouter.com/v1/models \
  -H "Authorization: Bearer $NEXOROUTER_API_KEY"

Guarda el ID seleccionado en configuración:

NEXOROUTER_MODEL=exact-model-id-from-the-catalog

Los IDs distinguen mayúsculas y minúsculas.

Ejecuta una evaluación repetible

Crea de 20 a 50 prompts representativos. Incluye solicitudes normales, casos ambiguos, entradas largas y fallos esperados.

Mantén constantes:

  • Instrucción de sistema.
  • Prompt del usuario.
  • temperature.
  • max_tokens.
  • Timeout y política de reintentos.

Registra:

  • Cumplimiento de la tarea.
  • Calidad de respuesta.
  • Tokens de entrada y salida.
  • Costo mostrado en Usage Logs.
  • Latencia y status.
  • Request ID de llamadas fallidas.

No declares un ganador con un solo prompt.

Pasa a producción de forma segura

  1. Valida la integración con un modelo de bajo costo.
  2. Prueba la lista corta con los mismos prompts.
  3. Crea una key dedicada con budget y alcance de modelos.
  4. Envía primero un porcentaje pequeño del tráfico.
  5. Supervisa Usage Logs y la tasa de error.
  6. Mantén un fallback revisado solo si tu aplicación tolera diferencias de salida.

Páginas relacionadas

Elige entre modelos desarrollados en China y modelos globales — NexoRouter