Aller au contenu principal
newspals
Sujets
Concepts
Rédaction
Newsletter
Français
AI Inference — Concepts | NewsPals
Concepts
·
AI Inference
le lore derrière le feed
AI Inference
Les stories qui ramènent sans cesse cette idée dans le feed.
2 articles
Dans le feed
ai-ml
Le LLMD gratuit de ZML pousse l’inférence de l’IA au-delà d’une seule pile de puces
Le serveur gratuit vise à accélérer les modèles open source sur les puces Nvidia, AMD, TPU, Apple et Intel, sans imposer de mariage avec un seul type d’accélérateur.
ai-ml
OpenAI a conçu sa propre puce. Voici pourquoi cet pari est plus important qu'il n'y paraît.
Jalapeño, le premier ASIC d'inférence personnalisé d'OpenAI développé avec Broadcom, échange la flexibilité contre le coût et le contrôle à l'échelle des LLM.
Aussi en vibe
Inférence IA
AMD ROCm
ASIC
Broadcom
Google TPU
Infrastructure IA
Nvidia
OpenAI