
IA
Dynamo restaura la inferencia de un LLM en 7,3 segundos
El motor sombra de NVIDIA mantiene una réplica ya inicializada en la misma GPU y comparte los pesos en memoria, con lo que el reinicio en frío de 283 segundos se vuelve innecesario.
NVIDIA Developer