L'accélérateur d'inférence Groq 3 LPX de Nvidia entre en production de masse
fr.wedoany.com Rapport : Le 24 août, lors de la conférence Hot Chips 2026, Nvidia a annoncé que son accélérateur Groq 3 LPX, conçu spécifiquement pour l'inférence des agents d'IA, est entré en phase de production de masse, marquant la commercialisation officielle du premier produit issu de l'acquisition de la licence technologique Groq pour 20 milliards de dollars en décembre 2025.

Le Groq 3 LPX est l'accélérateur d'inférence spécialisé de la plateforme de données Vera Rubin de Nvidia, axé sur la phase de « décodage » de l'inférence IA — l'étape clé qui détermine la vitesse de génération des tokens. Un seul rack LPX intègre 256 accélérateurs Groq 3 LPU, équipé de 128 Go de SRAM sur puce et d'une bande passante d'extension inter-puces de 640 To/s, adoptant l'architecture de rack MGX de Nvidia avec refroidissement entièrement liquide. Les puces sont fabriquées par Samsung Electronics, créant une différenciation stratégique dans la chaîne d'approvisionnement par rapport aux GPU de Nvidia (fabriqués par TSMC).
Dans les tests de référence de l'organisme tiers Artificial Analysis, le Groq 3 LPX exécutant le modèle open source Gemma 4 31B avec un contexte long de 100 000 tokens a atteint une vitesse de génération de 3 400 tokens de sortie par seconde, ce que Nvidia qualifie de performance d'inférence la plus rapide jamais enregistrée pour ce modèle, soit 4 fois plus rapide que les plateformes concurrentes sur les tâches sensibles à la latence.
Le fournisseur de services cloud IA Nebius a signé un contrat pour devenir le premier client de déploiement du Groq 3 LPX, offrant aux développeurs la capacité de génération de tokens ultra-rapide de cet accélérateur via sa plateforme d'inférence Nebius Token Factory. Dion Harris, directeur senior chez Nvidia, a déclaré que les racks Groq seront déployés chez Nebius aux côtés des processeurs centraux Vera et des processeurs graphiques Rubin, avec une mise en service officielle prévue au second semestre 2026. Danila Shtan, directeur technique de Nebius, a déclaré : « La génération est la phase d'inférence qui détermine la vitesse de réponse des systèmes d'IA, et c'est précisément ce que le Groq 3 LPX accélère. »
Jensen Huang, fondateur et directeur général de Nvidia, a déclaré que la plateforme Vera Rubin, grâce au Groq 3 LPX, a réalisé une configuration optimisée des usines de calcul pour l'ère des agents d'IA, « ce qui transforme la manière dont l'intelligence est produite, réalisant une nouvelle avancée majeure en termes de débit, d'efficacité et de vitesse de réponse de l'IA ».
Harris a souligné que le Groq 3 LPX ne vise pas à remplacer les GPU, mais à utiliser le processeur optimal pour des charges de travail spécifiques — les GPU continuent d'assurer l'entraînement des modèles et l'inférence générale, tandis que les puces Groq se concentrent sur la phase de « décodage » sensible à la latence. Nvidia a également annoncé que SpaceX a signé un contrat pour devenir le dernier client phare de la plateforme Vera Rubin, déployant les CPU Vera pour des tâches d'orchestration et de simulation intensives en CPU à travers les centres de données terrestres et les satellites en orbite. Les expéditions des systèmes Vera Rubin s'accélèrent, la production ayant démarré début 2026.
Produits Associés


Système de surveillance intelligente pour bande transporteuse
LUO YANG WIRE ROPE INSPECTION TECHNOLOGY CO., LTD.

Calibrateur de pression automatique intelligent ConST811A
Beijing ConST Instruments Technology Inc.

Terminal satellite portable à panneau plat - Terminal portable manuel de 0,35 mètre
China Starwin Science & Technology co., Ltd.
Tour de communication à quatre colonnes pour les lignes dédiées aux passagers
Henan Dingli Pole & Tower Co.,Ltd.
Commutateur industriel entièrement national
Shenzhen Yuhang Communication Technology Co., Ltd.
Solution de Prévention des Fuites de Données pour Bureaux
Sangfor Technologies Inc.
Projet d’installation mécanique et électrique pour l’industrialisation de matériaux semiconducteurs composés haut de gamme et de puces
Wuhan Huakang Century Clean Technology Co., Ltd.
Radar multifonction de surveillance océanique et de détection basse altitude, mesure de l'environnement dynamique océanique à la frontière air-mer (Agent/Lancement exclusif) — Fiche technique disponible
Chengdu Dixin Technology Co., Ltd.









