
Cohere abre North Small Translate, un MoE de 218B para traducir
El modelo activa 25.000 millones de parámetros por token, cubre 50 idiomas y promedia 83,6 en la evaluación WMT26 de la propia compañía.
7 notas publicadas

La versión nueva gasta menos tokens, pide ayuda al usuario cuando se traba y confirma antes de ejecutar acciones de consecuencia, según la propia empresa.

Z.ai y el equipo Qwen de Alibaba liberaron sus modelos sin coordinarse, pero las configuraciones son casi copias: mismo ratio de atención, mismo tope de 2.048 tokens y cuatro flujos residuales.

El nuevo modelo multimodal de peso abierto de Alibaba anticipa la arquitectura de Qwen4 y, según el equipo, se entrenó por cerca de un noveno de lo que costó Qwen3.7-Plus.

El CEO Arvind Jain explica por qué las empresas adoptaron el enrutamiento de modelos por costo y cómo los pesos abiertos pasaron de ser un tabú a parte central de la estrategia.

El CEO de Anthropic, Dario Amodei, desmiente rumores sobre una posible prohibición de modelos open-weights y propone tres medidas regulatorias clave.

Moonshot AI publica los pesos del modelo y libera parte de su infraestructura, mientras pruebas independientes exponen brechas en ciberseguridad y matematicas.
Otros temas que aparecen junto a #open weights en nuestra cobertura editorial.