Últimos artefactos abiertos (#24): Motif-3, GLM-5.3, Hy4-preview y licencias


El ecosistema de modelos abiertos sigue expandiéndose en alcance
Los lectores habituales de Artifacts saben que hemos estado cubriendo no solo los modelos, sino también sus licencias durante bastante tiempo. Hubo un periodo donde las licencias personalizadas eran la tendencia, como por ejemplo la licencia personalizada de Qwen2.5 72B-Instruct o las licencias de Llama. DeepSeek tenía una licencia personalizada para DeepSeek V3 antes de que R1 la cambiara a MIT, lo que ha llevado a que muchos creadores de modelos (chinos) adopten licencias MIT o Apache 2.0 en 2025.
En 2026, los modelos abiertos son más competitivos que nunca, lo que ha generado dos desarrollos interesantes: los fabricantes occidentales adoptan licencias abiertas, con Google y Meta migrando a Apache 2.0. Sin embargo, los fabricantes chinos en la frontera tecnológica se están volviendo más restrictivos: Kimi K3 incluye una licencia que exige acuerdos comerciales para quienes ejecuten servicios de inferencia o fine-tuning, y MiniMax M3 requiere acuerdos por encima de un umbral de ingresos y prohíbe casos de uso específicos.
La incorporación más reciente es GLM-5.3 de Zhipu, que pasó de MIT (usado en GLM-5.2 y versiones anteriores) a una licencia personalizada con la siguiente cláusula para proveedores de inferencia y fine-tuning:
Si el Licenciatario o cualquiera de sus afiliados opera un negocio de Modelo como Servicio (MaaS), y los ingresos agregados del Licenciatario y sus afiliados superan los 10 mil millones de dólares estadounidenses (o el equivalente en otras monedas) en total durante cualquier periodo consecutivo de 12 meses, el Licenciatario debe aprobar la revisión de seguridad de Z.AI antes de utilizar el Software o sus trabajos derivados para cualquier fin comercial. El alcance y método de la revisión de seguridad serán determinados razonablemente por Z.AI.
Aunque el umbral de 10 mil millones de dólares es muy elevado en comparación con otras licencias de este tipo, el término "afiliados" no está definido en la licencia, lo que añade incertidumbre y crea barreras para su adopción. Además, la licencia se proporciona tanto en inglés como en chino, donde el texto en chino utiliza "关联方" para las partes afiliadas, término que sí tiene una definición en la ley china.
No somos expertos legales y existen razones obvias por las cuales se crean dichas licencias. Sin embargo, queremos resaltar los problemas que conlleva generar tales licencias, especialmente en un mundo con muchas alternativas abiertas y cerradas válidas.
Nuestras selecciones
- Motif-3 por Motif-Technologies: Motif es una de las pocas joyas ocultas, demostrando innovación en el entrenamiento de modelos con recursos muy limitados en comparación con otros. Motif-3 viene con una licencia MIT y puntuaciones impresionantes para su tamaño. Dada la trayectoria de lanzamientos desde Motif 2.6B, que cubrimos en 2025 y Motif-2-12.7B, las mejoras son notables.
- dots3-note-prev por dots-studio: RedNote/Xiaohongshu, el Instagram chino, también se está tomando más en serio el entrenamiento de modelos. No son precisamente recién llegados, habiendo lanzado modelos desde 2025. dots3 logró ganar la IMO 2026 con una puntuación perfecta usando un harness interno. Esperamos más de ellos en el futuro cercano.
- Qwen3.8-Flash-Next por Qwen: Un adelanto de la próxima versión de los modelos Qwen en términos de arquitectura: 125B-A6B con 51B de embeddings n-gram. Utiliza GDN y Qwen Sparse Attention. Al igual que Qwen3-Next-80B-A3B-Instruct, esperamos que arquitecturas similares se vuelvan más populares y que el ecosistema solucione las integraciones para cuando se lance Qwen4.
- GLM-5.3-Flash por zai-org: Este lanzamiento perfeccionó la estrategia de modelos chinos que describimos en 2025. El modelo se lanzó como un "modelo sigiloso" de uso gratuito bajo el nombre "Ox-Alpha" en OpenRouter y OpenCode, lo que generó entusiasmo inicial. Luego, la comunidad especuló sobre su creador y tamaño, alegando que era un modelo de más de 1T de parámetros de Cursor/xAI, Gemini o un nuevo pre-entrenamiento de laboratorios de código abierto. Debido a su rendimiento, la especulación duró días, generando hype y mitigando las acusaciones de "benchmaxxing" que acompañan a cada lanzamiento de modelo abierto.
- Hy4-preview por tencent: Tencent se está convirtiendo en un actor serio en el espacio de modelos abiertos, aumentando el tamaño de su modelo insignia mientras impulsa su ciclo de post-entrenamiento. El resultado, Hy4-preview, es un modelo competente que actualmente tiene problemas de "sobrepensamiento". Sin embargo, si la trayectoria desde Hy3-preview hasta Hy3 sirve de indicación, el modelo final podría ser un contendiente legítimo en la vanguardia de los modelos abiertos.
Modelos
Propósito general
- NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16 por nvidia: Una actualización de Nemotron que ofrece mejoras de rendimiento y, especialmente, de velocidad en todos los aspectos.
- Ling-3.0-flash por inclusionAI: Ant Ling es un invitado frecuente en el registro de Artifacts; ahora están en su tercera iteración de modelos, adoptando un diseño híbrido (KDA + Gated MLA), similar a otros. También lanzaron una versión pequeña 7.9B-A1.3B.
- Qwen3.8-2.4T-A95B por Qwen: En un giro sorprendente, Alibaba comenzó a liberar abiertamente sus versiones más grandes de Qwen. Sin embargo, viene con una licencia personalizada y su rendimiento está por detrás de otros modelos de su tamaño.
Vía Interconnects.




