IANVIDIA cifra la inferencia y conserva el 96% del rendimientoLa medición corrió sobre DeepSeek-R1 en ocho GPU B200, con el cifrado encendido y apagado, y dejó el sobrecosto de latencia por token bajo el 5%.NVIDIA Developer·hace 1 hora