
IA
PyTorch lleva Helion a las TPU de Google con kernels autoajustados
El nuevo backend compila el lenguaje de kernels de PyTorch a Pallas y alcanza 838 TFLOPs en atención flash sobre una TPU v7, cerca del 79% de utilización de un tensor core.
PyTorch Blog
