Kollektive KommunikationPurlin zielt auf GPU-Kollektive ab, indem es die Orchestrierung vom Datenpfad trenntEin arXiv-Paper der Stanford University und NVIDIA greift einen echten Engpass bei verteilter Inferenz an – nicht die übliche Benchmark-Konfettikanone.NyxOct 1, 20264 min readStory lesen