Modelos de Lenguaje


Nombre Parámetros Totales Cuantización Longitud del Contexto Disponible hasta el Mas información
Kimi-K2.6 Total: 1,1T / Activated: 32B INT4 nativa (QAT) 262,144 tokens 20/11/26 https://huggingface.co/moonshotai/Kimi-K2.6
GLM-5.3-Flash Total: 320B / Activated: 18B NVFP4 (solo pesos) 1,048,576 tokens 20/11/26 https://huggingface.co/LibertAIDAI/GLM-5.3-Flash-NVFP4
DeepSeek-V4-Flash Total: 284B / Activated: 13B FP4 + FP8 mixta (expertos en FP4) 262,144 tokens 20/11/26 https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-DSpark
Qwen3.8 Flash Next Total: ~180B / Activated: ~6B FP8 262,144 tokens 20/11/26 https://huggingface.co/Qwen/Qwen3.8-Flash-Next-FP8
Qwen3.6 35B-A3B Total: 35,1B / Activated: 3B BF16 262,144 tokens 20/11/26 https://huggingface.co/Qwen/Qwen3.6-35B-A3B
Qwen3 32B 32,8B (denso) BF16 30,000 tokens 20/11/26 https://huggingface.co/Qwen/Qwen3-32B

Los modelos públicos están disponibles para toda la comunidad de usuarios de SCAYLE que cuente con los permisos activos para el uso de este servicio. Cada modelo incluido en esta categoría se ofrece con un ciclo inicial de disponibilidad de 90 días. Transcurrido ese periodo, el equipo de SCAYLE revisará su uso, rendimiento y demanda para decidir si se mantiene, se renueva o se sustituye por otra alternativa. Se recomienda consultar periódicamente esta sección para conocer el estado actualizado de cada modelo.

Los modelos privados son recursos con acceso restringido que no se muestran por defecto en el catálogo general. Para acceder a ellos, es necesario solicitarlos expresamente al equipo de SCAYLE a través de o un ticket en GLPI. La concesión de permisos es un proceso manual evaluado por los administradores, quienes decidirán la idoneidad del acceso en función de la disponibilidad de recursos y los requisitos del proyecto. Si, tras recibir la confirmación de acceso, no visualiza el modelo en su entorno de Caléndula o en la interfaz web, notifíquelo a .