Flujo de despliegue de redes neuronales con TVM: del algoritmo al runtime
Flujo de trabajo de TVM
Para desplegar un modelo de aprendizaje profundo sobre un nuevo acelerador, TVM sigue una cadena de compilación que va desde la representación del grafo hasta el código máquina. Los pasos principales son:
Importación del modelo: se lee el pesos y la arquitectura desde PyTorch, TensorFlow, ONNX u otros frameworks.
Conver ...
Publicado el 9-16 10:52