Documentación
Notas de latencia y moneda para equipos en Latinoamérica en la documentación de NexoRouter.
Notas de latencia y moneda para equipos en Latinoamérica
NexoRouter cobra el saldo prepago en USD. La latencia depende de la región de tu backend, el modelo elegido, el tamaño del prompt y las condiciones de upstream. Esta página no publica benchmarks de latencia ni precios no publicados.
Moneda y saldo prepago
- El crédito público es prepago en USD. Ver Precios y Precios y facturación.
- La documentación pública usa
1 USD = 500000 quota. - Las compras públicas de crédito empiezan en
$5. Checkout lista el crédito de API y la comisión de servicio de5.5%(mínimo$0.80) por separado. - Tu emisor de tarjeta, banco o método local puede agregar su propio FX, impuesto o comisión. NexoRouter no convierte las tarifas del modelo a moneda local en la página de catálogo.
- Billing es la fuente de verdad de los métodos de pago disponibles ahora.
Estima el gasto de prueba con la unidad publicada en la ficha del modelo y confirma el cargo real en Usage Logs.
Mide la latencia desde tu región
No copies un número de latencia de un blog, una página de proveedor o esta guía.
- Ejecuta el backend (o Replit, o un VPS pequeño) en la región más cercana a tus usuarios cuando puedas.
- Envía la misma solicitud pequeña de Chat Completions al model ID exacto que planeas usar.
- Registra el tiempo de punta a punta en tu cliente y el campo de latencia en Usage Logs.
- Repite en los horarios en los que realmente atiendes clientes.
- Compara un segundo catalog ID con el mismo prompt antes de mover infraestructura.
Si un modelo es lento, cambia de modelo o acorta el prompt antes de asumir que la región del gateway es la única causa. Ver ¿Qué región de servidor debo usar?.
Checklist de compra
- Una API key de producción con budget y alcance de modelos.
- Un catalog ID documentado, no un nombre de interfaz.
- Saldo prepago suficiente para la primera ventana de prueba.
- Acceso a Usage Logs para costo, latencia, status y request ID.
- Un model ID de respaldo que ya haya pasado el mismo conjunto de pruebas.
- Timeouts suficientes para modelos lentos; reintentos solo ante errores transitorios.