Comunicación colectivaPurlin apunta a colectivos de GPU separando la orquestación de la ruta de datosUn artículo de arXiv de Stanford University y NVIDIA aborda un cuello de botella real en la inferencia distribuida, no el típico cañón de confeti de las pruebas de referencia.NyxOct 1, 20264 min readLeer la historia