Qwen 3.8 Max ya es oficial. Alibaba presentó qwen3.8-max-preview el 19 de julio de 2026 y su documentación actual ya utiliza el identificador qwen3.8-max. Es el Qwen alojado que debes mirar si buscas el máximo nivel de la familia para código, análisis de datos, documentos e imágenes.
La compra no se entiende como una API normal por tokens. Su vía clara de acceso es el Model Studio Token Plan, una suscripción con créditos que sirve para herramientas interactivas como Claude Code, Qwen Code, Cursor u OpenCode. Si quieres alimentar un backend o ejecutar un robot, debes utilizar una clave estándar de pago por uso y esperar a que Alibaba publique las condiciones específicas de 3.8.
Respuesta rápida: qué debes saber antes de pagar
- Modelo actual:
qwen3.8-max; el ID anteriorqwen3.8-max-previewse enruta al modelo vigente según la documentación viva. - Acceso más claro: Token Plan Personal, con una clave dedicada
sk-sp-.... - Precio de lanzamiento internacional: desde 6 USD al mes; es promocional y puede cambiar.
- Claude Code: compatible mediante el endpoint Anthropic del plan.
- API de producción: no reutilices la clave del Token Plan en automatizaciones o backends.
- Benchmarks: todavía no hay una tabla oficial y reproducible propia de Qwen 3.8 Max.
- Pesos locales: no; Qwen 3.8 Max es alojado. Qwen3.6 es la familia abierta que debes comparar para uso local.
La documentación fue comprobada el 11 de agosto de 2026. Puedes ver el resto de modelos actuales en nuestro centro de inteligencia artificial.
Qwen3.8-Max-Preview y Qwen3.8-Max: por qué aparecen dos nombres
El lanzamiento utilizó qwen3.8-max-preview. Era un acceso anticipado dentro del Token Plan y Alibaba lo definía como el Qwen más capaz de ese momento, con razonamiento de texto y comprensión visual.
La página actual del plan ya muestra qwen3.8-max y explica que las solicitudes enviadas al identificador preview se dirigen al modelo estable. Es una transición de nombre, no dos productos que debas pagar por separado. Si configuras hoy una herramienta desde cero, usa el ID que aparezca en tu consola; si una configuración antigua sigue usando qwen3.8-max-preview, revisa el registro de cambios antes de modificar un flujo que funciona.
| Aspecto | Confirmado por Alibaba | Aún no publicado con detalle |
|---|---|---|
| Capacidades | Razonamiento, visión y generación de texto | Una model card técnica completa |
| Acceso | Token Plan y clientes OpenAI/Anthropic compatibles | Precio estándar por MTok de 3.8 |
| Herramientas | Búsqueda web, intérprete de código y extracción web en el plan | Coste público fijo de cada herramienta fuera de la consola |
| Calidad | Alibaba lo presenta como su Qwen más capaz | Tabla reproducible de benchmarks de 3.8 |
| Uso local | Servicio alojado | Pesos descargables de Qwen 3.8 Max |
Esta distinción evita dos errores habituales: copiar el precio de Qwen 3.7 como si fuera el de 3.8 y mezclar los benchmarks de la familia abierta Qwen3.6 con el nuevo modelo alojado.
Precio del Token Plan y límites de uso
La página internacional de lanzamiento publicó tres planes con precio anticipado. No son una tarifa por millón de tokens: cada mensaje consume Credits en función del modelo, el contexto y las herramientas utilizadas. La tabla siguiente corresponde a esa edición internacional anunciada en dólares. La edición Personal que Alibaba documenta actualmente para China se contrata en la región de Beijing, utiliza precios en CNY y mantiene promociones y condiciones propias; comprueba siempre la región y el importe que muestra tu consola antes de pagar.
| Plan | Créditos cada 5 horas | Límite cada 7 días | Precio inicial | Precio original anunciado |
|---|---|---|---|---|
| Lite | 700 | 2.500 | 6 USD/mes | 8 USD/mes |
| Standard | 3.000 | 10.000 | 18 USD/mes | 25 USD/mes |
| Pro | 12.000 | 40.000 | 68 USD/mes | 80 USD/mes |
En las condiciones internacionales del lanzamiento, los créditos no se acumulaban: la ventana corta se renovaba cada cinco horas y el techo semanal cada siete días. La documentación viva de la edición China/Beijing indica que el límite de cinco horas puede levantarse temporalmente durante su promoción, así que no conviene trasladar esa excepción a otras regiones. Las llamadas a búsqueda web, intérprete de código o extracción de páginas también descuentan Credits cuando se completan.
Qué plan tiene sentido: Lite sirve para probar sesiones cortas; Standard es el punto razonable si programas varias horas a la semana; Pro solo compensa cuando el historial, las herramientas y los agentes consumen de forma constante. Antes de pagar un ciclo largo, mira en la consola el precio actual y cuántos créditos ha gastado una sesión real de tu repositorio.
Cómo usar Qwen 3.8 Max en Claude Code
El Token Plan entrega una clave específica con formato sk-sp-.... No es la misma que una clave convencional de DashScope. Para clientes compatibles con Anthropic, el endpoint publicado es:
https://coding.dashscope.aliyuncs.com/apps/anthropic
Para clientes compatibles con OpenAI, la página de lanzamiento indica:
https://coding.dashscope.aliyuncs.com/v1
El flujo práctico es sencillo:
- Contrata el Token Plan en la región disponible y copia la clave dedicada desde My Subscriptions.
- Configura Claude Code con el endpoint Anthropic y la clave del plan.
- Selecciona
qwen3.8-maxo el nombre exacto que muestre la consola. - Abre un repositorio pequeño y comprueba edición, herramientas, consumo y errores antes de una sesión larga.
- Usa
/compacto inicia una sesión nueva cuando el historial deje de aportar valor.
No pegues la clave en un archivo del proyecto. Guárdala como variable de entorno y no la compartas: el plan es individual.
El límite de frecuencia no es la cuota del plan
Alibaba documenta para qwen3.8-max en el despliegue internacional de Singapur un máximo general de 600 solicitudes por minuto y 1 millón de tokens por minuto. Esos techos protegen el servicio, pero no sustituyen las cuotas de Credits ni garantizan que una ráfaga concreta sea aceptada. En el Token Plan mandan las condiciones y la región visibles en la consola de la cuenta.
También puede haber controles contra ráfagas. Un RPM alto no autoriza a lanzar un lote automatizado: la licencia del plan sigue limitando el uso a herramientas interactivas.
Qwen 3.8 frente a los modelos Qwen actuales
No todos los nombres Qwen resuelven el mismo problema.
| Modelo | Lo que ofrece | Acceso que encaja mejor | Cuándo elegirlo |
|---|---|---|---|
| Qwen 3.8 Max | Razonamiento, visión y herramientas en la gama más alta | Token Plan interactivo | Código difícil, documentos, análisis visual y agentes |
| Qwen 3.7 Max | Razonamiento y API con tarifa pública | Pago por uso | Backend estable con coste medible por token |
| Qwen 3.7 Plus | Multimodal y contexto largo | API de gran volumen | Documentos, imágenes y flujos que priorizan coste |
| Qwen 3.7 Flash | Respuesta rápida con límites altos de frecuencia | API económica | Clasificación, extracción y tareas frecuentes |
| Qwen 3.6 Flash | Multimodal incluido en el Token Plan actual | Suscripción interactiva | Respaldo rápido dentro del mismo plan |
| Qwen3.6 27B / 35B-A3B | Pesos abiertos Apache 2.0 | Equipo local o servidor propio | Privacidad, control y despliegue sin proveedor cerrado |
La tarifa internacional publicada para Qwen 3.7 Max es de 2,50 USD por millón de tokens de entrada y 7,50 USD por millón de salida. No la atribuyas a Qwen 3.8: la tabla estándar todavía no contiene una fila equivalente para el nuevo modelo.
Para comparar con otros proveedores chinos, consulta nuestro análisis de Kimi K3 y su acceso para código. Si buscas pesos descargables, la guía de alternativas abiertas a Claude separa modelos locales y servicios alojados.
¿Dónde están los benchmarks de Qwen 3.8 Max?
Alibaba describe Qwen 3.8 Max como el miembro más capaz de la familia, pero no ha publicado una tabla técnica reproducible con resultados, configuración y rivales para esta versión. Eso impide responder con rigor que supera a Kimi K3, Claude Opus 5 o GPT-5.6 en una tarea concreta.
La forma útil de evaluarlo hoy es más directa:
- usa el mismo repositorio y el mismo prompt en dos modelos;
- fija las herramientas permitidas;
- mide si compila, cuántos archivos rompe y cuántas correcciones necesita;
- anota el consumo de Credits y el tiempo total;
- repite al menos cinco tareas representativas.
Cuando Alibaba publique cifras propias, deberán leerse como resultados del fabricante y no como sustituto de esta prueba. Nuestra guía para comparar límites y modelos de IA explica cómo separar contexto, cuota, coste y calidad.
¿Merece la pena Qwen 3.8 Max?
Sí, si quieres probar el Qwen más potente dentro de Claude Code o Qwen Code y prefieres una cuota predecible. El plan Standard es el primer nivel que miraría para trabajo frecuente; Lite permite comprobar el encaje con menos compromiso.
No es la compra adecuada para una aplicación que atiende usuarios de forma automática. Ahí necesitas pago por uso, registros de consumo y condiciones de producción claras; Qwen 3.7 Max ofrece hoy una referencia de precio mucho más transparente. Tampoco es un sustituto de Qwen3.6 local: compartir marca no convierte al modelo alojado en software descargable.
El atractivo de 3.8 está en reunir razonamiento, visión y herramientas dentro del flujo de programación. Su principal incógnita no es el nombre, sino cuánto mejora tus tareas reales por cada crédito consumido. Empieza con un proyecto controlado, mide dos o tres sesiones y solo entonces sube de plan.
Consulta también cómo elaboramos nuestras guías y análisis.
Cómo hemos preparado este análisis
Contrastamos especificaciones, fuentes enlazadas y opciones de compra para ayudarte a decidir. La recomendación final es el criterio editorial de Tecno-V.

Comentarios de la comunidad
Todavía no hay comentarios publicados por la comunidad.