Conectar Kimi (Moonshot) a JMAX
Guía hecha sobre la certificación real del 11 de septiembre de 2026, con la
clave del cliente y el ejecutable instalado (JMAX v0.2.4, 262 herramientas).
Las capturas son las de esa sesión, en tomas/.
Vídeo tutorial: 36 · Conectar Kimi (Moonshot).
Ojo: en JMAX hay DOS tarjetas que se llaman Kimi
| Tarjeta | Qué es |
|---|---|
Kimi Quantizado DGX (spark-kimi) |
el Kimi que corre en tu propia máquina, cuantizado, servido por el DGX Spark. No tiene API key. |
Kimi (Moonshot) (kimi) |
el servicio de nube de Moonshot AI, el de esta guía. Es el que pide clave. |
Esta guía es la de la API externa. Si pegas la clave en la tarjeta equivocada no pasa nada, pero no verás dónde ponerla: la local no tiene campo.
Lo que hay que saber antes de empezar (2026)
- La clave se crea en https://platform.moonshot.ai/console/api-keys y
empieza por
sk-. - Moonshot tiene dos mundos separados:
.aiy.cn. No comparten cuentas. La misma clave que da 200 enhttps://api.moonshot.ai/v1da 401 Invalid Authentication enhttps://api.moonshot.cn/v1. JMAX viene apuntando a.ai, que es el internacional. - La cuenta necesita saldo, consultable en
https://api.moonshot.ai/v1/users/me/balance. En el caso real quedaban 16,31 USD. - El catálogo cambió. La lista de fábrica de JMAX decía
kimi-k3y losmoonshot-v1-*; lo que ofrece la cuenta hoy es:
| Modelo | Para qué | Latencia medida («responde ok») |
|---|---|---|
kimi-k3 |
el buque insignia, el cerebro grande | 5,6 s |
kimi-k2.6 |
generalista de la generación anterior | 6,5 s |
kimi-k2.7-code |
programación | 1,7 s |
kimi-k2.7-code-highspeed |
programación, rápido | 1,1 s |
- Todos razonan y devuelven
reasoning_contentaparte del texto.kimi-k2.6llegó a gastar 492 tokens de razonamiento para contestar «ok»: con el cupo corto, la respuesta vuelve vacía. - No hay modelo de visión en este catálogo: el rol Visión tiene que quedarse en otro proveedor.
Pasos
1. Abrir la tarjeta de Kimi (Moonshot)
Menú → Gestión y Administración → Proveedores → tarjeta Kimi (Moonshot), no la del DGX.

2. Pegar la clave
Campo API key → pegar → Guardar clave.

3. Comprobar el catálogo vivo
Al guardar, JMAX pregunta y sustituye la lista de fábrica por los cuatro modelos reales de la cuenta.

4. Probar conexión

✓ kimi-k2.6 respondió en 12726 ms. Doce segundos es mucho para un «ok», y no
es la red: es el modelo pensando. Si vas a usar Kimi para el rol rápido, elige
kimi-k2.7-code-highspeed.
5. Repartir los roles
| Rol | Modelo | Por qué |
|---|---|---|
| Cerebro grande | kimi-k3 |
el trabajo con herramientas y búsqueda |
| Rápido | kimi-k2.7-code-highspeed |
1,1 s frente a los 5-6 s de los otros |
| Respaldo | kimi-k2.7-code-highspeed |
mismo motivo, y de la misma cuenta |
| Visión | otro proveedor | Kimi no trae modelo de visión |
| Datos personales | seudonimizar |
ver más abajo |
6. Prueba de uso real
Encargo: «Busca en internet qué es el modelo Kimi K2 de Moonshot AI y para qué sirve, y resúmelo en tres líneas con su enlace.»

Cinco pasos (cerebro grande → búsqueda → dos páginas leídas → redacción),
6 fuentes consultadas y 53,0 s, con kimi-k3. Es el más lento de los
cinco proveedores certificados, y la razón se ve en los tiempos de arriba:
piensa mucho antes de hablar.

Lo que se arregló en esta certificación
Kimi no necesitó cambios de cliente —habla el dialecto de OpenAI—, pero sacó a la luz un defecto de la pantalla de pruebas:
«Probar conexión» pedía 256 tokens. kimi-k2.6 se los gastaba razonando y
devolvía la respuesta vacía: la prueba salía en verde, muda, y eso invitaba
a elegir como cerebro un modelo que no había dicho ni una palabra. Ahora pide
1024 y, si aun así el modelo contesta sin texto, la prueba sale en ámbar
con el aviso: «respondió, pero se gastó todo el cupo razonando y no dijo nada.
Sirve mejor como cerebro grande que como rápido.», en los seis idiomas.
Ya venía de antes, y sigue haciendo falta con Kimi: el saneado del historial
que quita los turnos de asistente vacíos, porque Moonshot responde 400 the
message at position N with role 'assistant' must not be empty y deja la
conversación inservible hasta reiniciarla.
Seudonimización y datos personales
Con el modo bloquear todos los turnos se quedan en el cerebro local y
Kimi no contesta nunca. Para usar la nube, seudonimizar: nombres,
documentos y teléfonos salen como [PERSONA_1], [DOCUMENTO_1]… y vuelven con
el valor real. Salud, contraseñas y tarjetas nunca salen.
Como con DeepSeek, hay que decirlo: Moonshot es un servicio chino, fuera de la UE. Si el cliente tiene compromiso de residencia de datos, este proveedor no vale para los espacios con datos de clientes. La alternativa sin salir del equipo es la otra tarjeta: Kimi Quantizado en el DGX Spark.
Revocar una clave
https://platform.moonshot.ai/console/api-keys → la clave → Delete. Hazlo con cualquier clave que hayas pegado en un chat, un correo o un ticket.
¿No encuentras la respuesta?
Cuéntanos qué pasa: el ticket queda unido a tu licencia y te respondemos por correo.