
IA
Muse Glimmer en ExecuTorch: 33 tok/s en un Mac M5 Pro
PyTorch habilita el modelo abierto de 30 mil millones de parámetros de Meta en GPU NVIDIA y Mac con silicio de Apple, con decodificación especulativa DFlash y contexto de 128K tokens.
PyTorch Blog