Saltar al contenido principal

Conectar Kimi a JMAX

Conectar Kimi (Moonshot) a JMAX​

Guía hecha sobre la certificación real del 11 de septiembre de 2026, con la clave del cliente y el ejecutable instalado (JMAX v0.2.4, 262 herramientas). Las capturas son las de esa sesión, en tomas/.

Vídeo tutorial: 36 · Conectar Kimi (Moonshot).

Ojo: en JMAX hay DOS tarjetas que se llaman Kimi​

TarjetaQué es
Kimi Quantizado DGX (spark-kimi)el Kimi que corre en tu propia máquina, cuantizado, servido por el DGX Spark. No tiene API key.
Kimi (Moonshot) (kimi)el servicio de nube de Moonshot AI, el de esta guía. Es el que pide clave.

Esta guía es la de la API externa. Si pegas la clave en la tarjeta equivocada no pasa nada, pero no verás dónde ponerla: la local no tiene campo.

Lo que hay que saber antes de empezar (2026)​

  1. La clave se crea en https://platform.moonshot.ai/console/api-keys y empieza por sk-.

  2. Moonshot tiene dos mundos separados: .ai y .cn. No comparten cuentas. La misma clave que da 200 en https://api.moonshot.ai/v1 da 401 Invalid Authentication en https://api.moonshot.cn/v1. JMAX viene apuntando a .ai, que es el internacional.

  3. La cuenta necesita saldo, consultable en https://api.moonshot.ai/v1/users/me/balance. En el caso real quedaban 16,31 USD.

  4. El catálogo cambió. La lista de fábrica de JMAX decía kimi-k3 y los moonshot-v1-*; lo que ofrece la cuenta hoy es:

    ModeloPara quéLatencia medida («responde ok»)
    kimi-k3el buque insignia, el cerebro grande5,6 s
    kimi-k2.6generalista de la generación anterior6,5 s
    kimi-k2.7-codeprogramación1,7 s
    kimi-k2.7-code-highspeedprogramación, rápido1,1 s
  5. Todos razonan y devuelven reasoning_content aparte del texto. kimi-k2.6 llegó a gastar 492 tokens de razonamiento para contestar «ok»: con el cupo corto, la respuesta vuelve vacía.

  6. No hay modelo de visión en este catálogo: el rol Visión tiene que quedarse en otro proveedor.

Pasos​

1. Abrir la tarjeta de Kimi (Moonshot)​

Menú → Gestión y Administración → Proveedores → tarjeta Kimi (Moonshot), no la del DGX.

2. Pegar la clave​

Campo API key → pegar → Guardar clave.

3. Comprobar el catálogo vivo​

Al guardar, JMAX pregunta y sustituye la lista de fábrica por los cuatro modelos reales de la cuenta.

4. Probar conexión​

✓ kimi-k2.6 respondió en 12726 ms. Doce segundos es mucho para un «ok», y no es la red: es el modelo pensando. Si vas a usar Kimi para el rol rápido, elige kimi-k2.7-code-highspeed.

5. Repartir los roles​

RolModeloPor qué
Cerebro grandekimi-k3el trabajo con herramientas y búsqueda
Rápidokimi-k2.7-code-highspeed1,1 s frente a los 5-6 s de los otros
Respaldokimi-k2.7-code-highspeedmismo motivo, y de la misma cuenta
Visiónotro proveedorKimi no trae modelo de visión
Datos personalesseudonimizarver más abajo

6. Prueba de uso real​

Encargo: «Busca en internet qué es el modelo Kimi K2 de Moonshot AI y para qué sirve, y resúmelo en tres líneas con su enlace.»

Cinco pasos (cerebro grande → búsqueda → dos páginas leídas → redacción), 6 fuentes consultadas y 53,0 s, con kimi-k3. Es el más lento de los cinco proveedores certificados, y la razón se ve en los tiempos de arriba: piensa mucho antes de hablar.

Lo que se arregló en esta certificación​

Kimi no necesitó cambios de cliente —habla el dialecto de OpenAI—, pero sacó a la luz un defecto de la pantalla de pruebas:

«Probar conexión» pedía 256 tokens. kimi-k2.6 se los gastaba razonando y devolvía la respuesta vacía: la prueba salía en verde, muda, y eso invitaba a elegir como cerebro un modelo que no había dicho ni una palabra. Ahora pide 1024 y, si aun así el modelo contesta sin texto, la prueba sale en ámbar con el aviso: «respondió, pero se gastó todo el cupo razonando y no dijo nada. Sirve mejor como cerebro grande que como rápido.», en los seis idiomas.

Ya venía de antes, y sigue haciendo falta con Kimi: el saneado del historial que quita los turnos de asistente vacíos, porque Moonshot responde 400 the message at position N with role 'assistant' must not be empty y deja la conversación inservible hasta reiniciarla.

Seudonimización y datos personales​

Con el modo bloquear todos los turnos se quedan en el cerebro local y Kimi no contesta nunca. Para usar la nube, seudonimizar: nombres, documentos y teléfonos salen como [PERSONA_1], [DOCUMENTO_1]… y vuelven con el valor real. Salud, contraseñas y tarjetas nunca salen.

Como con DeepSeek, hay que decirlo: Moonshot es un servicio chino, fuera de la UE. Si el cliente tiene compromiso de residencia de datos, este proveedor no vale para los espacios con datos de clientes. La alternativa sin salir del equipo es la otra tarjeta: Kimi Quantizado en el DGX Spark.

Revocar una clave​

https://platform.moonshot.ai/console/api-keys → la clave → Delete. Hazlo con cualquier clave que hayas pegado en un chat, un correo o un ticket.