Conectar Qwen a JMAX
Conectar Qwen (Alibaba Model Studio) a JMAX
Guía hecha sobre la certificación real del 12 de septiembre de 2026, con las
claves del cliente y el ejecutable instalado (JMAX v0.2.4, 262 herramientas).
Las capturas son las de esa sesión, en tomas/.
Vídeo tutorial: 37 · Conectar Qwen.
El caso que trajo esta guía: dos claves, una funcionó y la otra no
La primera clave autenticaba bien —listaba los 165 modelos del catálogo— pero cualquier llamada devolvía:
403 {"error":{"type":"AccessDenied.Unpurchased",
"message":"Access to model denied. Please make sure you are eligible for using the model."}}
Probé 16 modelos distintos: los 16 iguales. La segunda clave, de una cuenta con Model Studio ya activado, funcionó a la primera contra el mismo endpoint.
La diferencia no es la clave: es la activación. El cupo gratuito se concede al activar Model Studio, y sin activar no se puede llamar a nada aunque la credencial sea válida. Conviene saberlo porque el síntoma engaña: la clave parece buena (y lo es) y el catálogo se ve entero.
Lo que hay que saber antes de empezar (2026)
-
La consola es la internacional: https://modelstudio.console.alibabacloud.com/, región Singapur (
ap-southeast-1). La china (aliyun.com) es otro mundo: sus claves dan 401 contra este endpoint y viceversa. Lo comprobé con la misma clave en los dos. -
El endpoint es
https://dashscope-intl.aliyuncs.com/compatible-mode/v1y ya viene puesto. Cada workspace tiene además un dominio propio (https://ws-XXXX.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1) que aparece en la pantalla de API Key; las dos direcciones funcionan con una clavesk-ws-, así que no hace falta cambiar nada en JMAX. -
Hay tres prefijos de clave y no son intercambiables:
sk-para pago por uso,sk-sp-para Token Plan o Coding Plan, ysk-ws-para workspace. -
El cupo gratuito de usuario nuevo NO es una bolsa única. Los «70 millones de tokens» del anuncio son la suma de muchos cupos separados:
- ~1.000.000 de tokens por modelo, y cada modelo tiene el suyo.
qwen3.7-maxyqwen3.7-max-2026-05-17cuentan como dos modelos distintos, cada uno con su millón.- 90 días desde la activación. Vence aunque no lo gastes, no se reemite, y crear otra cuenta no da otro cupo.
- Cubre solo inferencia en tiempo real: no batch, no fine-tuning, no despliegues dedicados, no almacenamiento.
- Al agotarse un modelo no salta solo a otro que aún tenga cupo.
- Enciende Free Quota Only para que el servicio se pare al acabarse el cupo, en vez de pasar a cobrarte.
Para JMAX esto tiene una consecuencia práctica: repartir los roles entre modelos distintos multiplica el cupo. Cuatro roles en cuatro modelos son cuatro millones de tokens, no uno.
Pasos
1. Abrir la tarjeta de Qwen
Menú → Gestión y Administración → Proveedores → tarjeta Qwen (DashScope).
2. Pegar la clave
Campo API key → pegar → Guardar clave.
3. Comprobar el catálogo vivo
Al guardar, JMAX pregunta y trae 165 modelos. Es con diferencia el catálogo más grande de los certificados, y el más mezclado: además de los Qwen propios vienen los de otras casas revendidas (Kimi, DeepSeek, GLM) y familias enteras que no conversan —imagen, vídeo, voz, OCR, traducción, actas—.
4. Probar conexión
✓ qwen-coder-plus respondió en 1443 ms.
5. Repartir los roles
Latencias medidas contra la API para un «responde ok»:
| Modelo | Tiempo | Nota |
|---|---|---|
qwen-flash | 1,4 s | el más rápido |
qwen3-vl-plus | 1,5 s | visión |
qwen-plus | 1,5 s | generalista barato |
qwen3-max | 2,1 s | |
qwen3.8-max | 3,2 s | el buque insignia, razona |
deepseek-v4-pro | 3,7 s | revendido |
kimi-k3 | 33,8 s | revendido, muy lento aquí |
| Rol | Modelo | Por qué |
|---|---|---|
| Cerebro grande | qwen3.8-max | el trabajo con herramientas y búsqueda |
| Rápido | qwen-flash | 1,4 s, y cupo propio |
| Respaldo | qwen-plus | otro modelo, otro millón de tokens |
| Visión | qwen3-vl-plus | Qwen sí mira imágenes, a diferencia de DeepSeek y Kimi |
| Datos personales | seudonimizar | ver más abajo |
La visión quedó comprobada: se le pasó una captura de la propia pantalla de Proveedores y contestó «Se ve la interfaz de configuración de proveedores de modelos de inteligencia artificial en la plataforma JMAX…».
6. Prueba de uso real
Encargo: «Busca en internet qué es el modelo Qwen3 de Alibaba y para qué sirve, y resúmelo en tres líneas con su enlace.»
Diez pasos (cerebro grande → búsquedas → tres páginas leídas → redacción),
12 fuentes consultadas —el número más alto de los cinco proveedores
certificados— y 46,1 s, con qwen3.8-max.
Lo que se arregló en esta certificación
Qwen no necesitó cambios en el cliente —habla el dialecto de OpenAI—, pero su catálogo sacó a la luz tres defectos de JMAX:
- El 403 se contaba como «Qwen rechaza la clave», que manda a regenerar una credencial perfecta. Ahora ese caso tiene su propia explicación en los seis idiomas y dice en voz alta que la clave está bien.
- Los modelos revendidos se colaban delante. Por orden alfabético,
ZHIPU/GLM-5.3encabezaba la lista: la tarjeta de Qwen proponía como cerebro el modelo de otra casa, y «Probar conexión» lo probaba a él. Ahora los del propio proveedor van primero. - Faltaban oficios en el filtro de «esto no conversa». El catálogo trae
reconocimiento de voz (
asr), lectura de documentos (ocr), traducción (qwen-mt-*,livetranslate), actas de reunión (tingwu) y atención al cliente (ccai-pro). Ninguno responde a un turno de chat y cualquiera podía acabar de cerebro.
Y el preset apuntaba a la consola china teniendo el endpoint internacional. Corregido, con nota de que hay que activar el servicio.
Seudonimización y datos personales
Con el modo bloquear todos los turnos se quedan en el cerebro local y
Qwen no contesta nunca. Para usar la nube, seudonimizar: nombres,
documentos y teléfonos salen como [PERSONA_1], [DOCUMENTO_1]… y vuelven con
el valor real. Salud, contraseñas y tarjetas nunca salen.
Igual que con DeepSeek y Kimi: Alibaba es un servicio chino. La región de Singapur está fuera de la UE. Si el cliente tiene compromiso de residencia de datos, este proveedor no vale para los espacios con datos de clientes.
Revocar una clave
Consola → API Key → la clave → Delete (o Disable, que la suspende sin borrarla). Hazlo con cualquier clave que hayas pegado en un chat, un correo o un ticket.