Inferencia acelerada de PyTorch con Torch.compile en procesadores Graviton de AWS
Originalmente, PyTorch usaba un modo ansioso en el que cada operación de PyTorch que forma el modelo se ejecuta de forma independiente tan pronto como se alcanza. PyTorch 2.0 introdujo…