Volver al blog

2026-09-02

Anuncios oficiales de agosto: Qwen3.8, GLM-5.3, MiniMax H3 y DeepSeek Vision

Agosto de 2026 concentró varios lanzamientos de laboratorios chinos que importan si operas un gateway OpenAI-compatible hacia LatAm. Aquí va un resumen original de hechos publicados en sitios oficiales (no WeChat pegado), con fecha y URL, más el estado del catálogo NexoRouter el 2 de septiembre de 2026.

Línea de tiempo abstracta de anuncios oficiales ago 2026

3 ago — Alibaba Qwen3.8-Max

Alibaba Cloud Community publicó Qwen3.8-Max: 2.4T parámetros totales / 95B activos, contexto hasta 1M, multimodal, API en Model Studio / QwenCloud. El 27 de agosto el mismo canal detalla Qwen3.8-Flash-Next como preview de arquitectura hacia Qwen4 (125B + embeddings n-gram, 6B activos; producción como qwen3.8-flash en QwenCloud a tarifas oficiales del vendor).

En NexoRouter (2 sep): qwen3.8-max estaba listado con precio Pendiente. Qwen/Qwen3-Max sí tenía $0.35 / 1M entrada y $1.40 / 1M salida. Usa el ID exacto de la ficha.

3 ago — MiniMax H3 open source

MiniMax publicó Open General Intelligence: MiniMax H3 Is Now Open Source el 3 de agosto de 2026: sistema de video omni-modal, hasta 15 s, 2K vía regeneración, audio estéreo 32 kHz, checkpoints FL2VA / Ref2VA bajo licencia comunitaria.

En NexoRouter: MiniMax-H3 aparecía con precio Pendiente. Para chat con precio publicado ese día, MiniMax-M3 mostraba $2.04 / $0.41 / $8.17 por 1M tokens.

14 ago — Z.ai GLM-5.3

GLM-5.3 (14 ago 2026): post-entrenamiento sobre la base de GLM-5.2, énfasis en coding agent y benchmarks públicos citados por Z.ai; thinking obligatorio con reasoning_effort.

En NexoRouter: ya están glm-5.3 ($1.22 / $0.30 / $4.26) y glm-5.3-flash ($0.12 / $0.03 / $0.43). No confundir con glm-5.2 / glm-5.2-sg (IDs distintos).

13–21 ago — DeepSeek V4 GA y Vision Exp

El changelog DeepSeek del 13 ago confirma GA de V4-Pro y ajustes de pricing peak/off-peak en el API oficial (vigencia 16 ago UTC). El 21 ago añade deepseek-v4-flash-vision-exp.

En NexoRouter: deepseek-v4-flash-0731 con precio publicado; varias variantes -sg / vision / pro-0813 con Pendiente o tarifas distintas. Verifica en /models?q=deepseek-v4.

Cómo actuar desde LatAm (sin tono de “bitácora interna”)

1. Abre el anuncio oficial (tabla abajo) y anota el nombre de modelo del vendor.

2. Busca el ID en Modelos. Si no está o está Pendiente, no presupuestes.

3. Prueba en Playground.

4. Integra con Chat Completions según /docs y primera llamada.

5. Para comparación de capacidad vs precio, usa elige modelos.

Flujo /models → Playground

Tabla de fuentes oficiales

| Fecha | Vendor | Título / tema | URL |

| --- | --- | --- | --- |

| 2026-08-03 | Alibaba / Qwen | Qwen3.8-Max | https://www.alibabacloud.com/blog/alibaba-unveils-qwen3-8-max-its-largest-and-most-capable-flagship-model-to-date_603420 |

| 2026-08-27 | Alibaba / Qwen | Qwen3.8-Flash-Next | https://www.alibabacloud.com/blog/603501 |

| 2026-08-03 | MiniMax | H3 open source | https://www.minimax.io/news/minimax-h3-open-source |

| 2026-08-14 | Z.ai | GLM-5.3 | https://z.ai/blog/glm-5.3 |

| 2026-08-13 / 21 | DeepSeek | V4-Pro GA + Vision Exp | https://api-docs.deepseek.com/updates/ |

| 2026-04-24 | DeepSeek | V4 Preview | https://www.deepseek.com/en/news/v4-preview/ |

| 2026-07-16 | Moonshot | Kimi K3 (contexto flagship) | https://www.moonshot.ai/ |

WeChat (mp.weixin.qq.com) suele bloquear bots; por eso priorizamos sitios oficiales y docs fetchables. Si mañana el catálogo añade un ID, esa ficha manda sobre cualquier resumen de blog.

Qué no hacer

No copies párrafos largos de WeChat o del blog del vendor al sitio: eso dispara riesgo de copyright y de contenido duplicado en Google. Resume el hecho (fecha, ID, capacidad anunciada), atribuye con deep-link y dirige al lector a /models para el string de precio.

No asumas que “está en OpenRouter” o “está en UCloud” autoriza a inventar un SKU en NexoRouter. Si el directorio no muestra el ID, el blog no debe fingir disponibilidad.

No compares TTFT ni “somos más baratos que X” sin una captura viva y comparable. Esta serie de posts solo cita precios de lista de NexoRouter y hechos de páginas oficiales.

Para equipos que ya usan un solo cliente OpenAI en México o el Cono Sur, el valor está en reducir fricción: un base_url, un key vault, y un directorio filtrable. Cuando Qwen, Z.ai, DeepSeek o MiniMax publiquen el siguiente ID, el checklist de arriba se repite en minutos, no en una semana de reescritura de SDKs.

Lecturas relacionadas en NexoRouter