Documentación

Notas de latencia y moneda para equipos en Latinoamérica en la documentación de NexoRouter.

Notas de latencia y moneda para equipos en Latinoamérica

NexoRouter cobra el saldo prepago en USD. La latencia depende de la región de tu backend, el modelo elegido, el tamaño del prompt y las condiciones de upstream. Esta página no publica benchmarks de latencia ni precios no publicados.

Moneda y saldo prepago

  • El crédito público es prepago en USD. Ver Precios y Precios y facturación.
  • La documentación pública usa 1 USD = 500000 quota.
  • Las compras públicas de crédito empiezan en $5. Checkout lista el crédito de API y la comisión de servicio de 5.5% (mínimo $0.80) por separado.
  • Tu emisor de tarjeta, banco o método local puede agregar su propio FX, impuesto o comisión. NexoRouter no convierte las tarifas del modelo a moneda local en la página de catálogo.
  • Billing es la fuente de verdad de los métodos de pago disponibles ahora.

Estima el gasto de prueba con la unidad publicada en la ficha del modelo y confirma el cargo real en Usage Logs.

Mide la latencia desde tu región

No copies un número de latencia de un blog, una página de proveedor o esta guía.

  1. Ejecuta el backend (o Replit, o un VPS pequeño) en la región más cercana a tus usuarios cuando puedas.
  2. Envía la misma solicitud pequeña de Chat Completions al model ID exacto que planeas usar.
  3. Registra el tiempo de punta a punta en tu cliente y el campo de latencia en Usage Logs.
  4. Repite en los horarios en los que realmente atiendes clientes.
  5. Compara un segundo catalog ID con el mismo prompt antes de mover infraestructura.

Si un modelo es lento, cambia de modelo o acorta el prompt antes de asumir que la región del gateway es la única causa. Ver ¿Qué región de servidor debo usar?.

Checklist de compra

  • Una API key de producción con budget y alcance de modelos.
  • Un catalog ID documentado, no un nombre de interfaz.
  • Saldo prepago suficiente para la primera ventana de prueba.
  • Acceso a Usage Logs para costo, latencia, status y request ID.
  • Un model ID de respaldo que ya haya pasado el mismo conjunto de pruebas.
  • Timeouts suficientes para modelos lentos; reintentos solo ante errores transitorios.

Páginas relacionadas