Together AI signe un accord de 240 millions de dollars avec IBM Cloud pour des capacités de calcul
2026-08-13 16:02
Favoris

fr.wedoany.com Rapport : Le 11 août, IBM et la plateforme cloud d'intelligence artificielle Together AI ont signé un accord pluriannuel de 240 millions de dollars. IBM construira aux États-Unis un cluster d'inférence d'IA à grande échelle basé sur les systèmes NVIDIA HGX B300, fournissant des capacités de calcul cloud pour les services d'inférence de modèles ouverts de Together AI. Ce cluster devrait être mis en service au premier trimestre 2027.

Le cluster sera déployé sur IBM Cloud, avec une première phase prévoyant environ 2 000 puces NVIDIA Blackwell Ultra B300, et utilisera la plateforme réseau Ethernet NVIDIA Spectrum-X pour connecter les nœuds de calcul. IBM a indiqué qu'il s'agit du premier cluster de calcul de sa plateforme cloud à adopter les technologies HGX B300 et Spectrum-X, spécifiquement dédié aux opérations d'inférence d'IA à grande échelle.

La plateforme HGX B300 est utilisée par les fabricants de serveurs pour construire des systèmes d'IA haute densité. Chaque ensemble HGX B300 est configuré avec 8 GPU Blackwell Ultra, avec une capacité totale de mémoire GPU de 2,1 To, utilisant une interconnexion NVLink de cinquième génération, avec une bande passante totale d'interconnexion entre GPU atteignant 14,4 To/s et une bande passante réseau de 1,6 To/s. Sur la base d'environ 2 000 puces, le déploiement initial équivaut à environ 250 systèmes HGX B300 à huit cartes, le nombre réel de serveurs et la configuration des baies restant soumis au plan d'ingénierie final.

Contrairement aux clusters de calcul principalement destinés à l'entraînement de modèles, ce projet se concentre sur l'inférence de modèles, c'est-à-dire l'utilisation de modèles déjà entraînés pour traiter les requêtes des utilisateurs et générer du texte, du code ou d'autres contenus. Together AI exploitera ce cluster pour exécuter des modèles ouverts tels que DeepSeek, MiniMax et Kimi, offrant aux clients entreprises des services d'appel de modèles et d'inférence de niveau production.

Kai Mak, directeur du chiffre d'affaires de Together AI, a déclaré que la société s'attend à ce que les capacités de calcul concernées soient entièrement réservées deux à trois mois avant la mise en service officielle. Together AI traite actuellement environ 400 000 milliards de jetons par mois. Alors que les clients entreprises élargissent leurs déploiements de modèles ouverts, la société augmente ses ressources GPU par le biais de constructions internes, de locations et d'accords de capacité cloud à long terme.

En juillet 2026, Together AI a bouclé un tour de financement de série C de 800 millions de dollars, avec une valorisation post-financement de 8,3 milliards de dollars. Ce tour a été mené par Prosperity7 Ventures, filiale de Saudi Aramco, avec la participation de NVIDIA, Vista Equity Partners, General Catalyst et d'autres institutions. La société prévoit d'utiliser les fonds levés pour développer ses produits et son infrastructure de calcul, avec pour objectif de multiplier par environ 50 la taille de son infrastructure globale au cours des cinq prochaines années.

Cet accord élargira également le déploiement des capacités de calcul Blackwell Ultra sur IBM Cloud. IBM avait déjà annoncé la mise à disposition de GPU NVIDIA Blackwell Ultra sur sa plateforme cloud pour l'entraînement de grands modèles, l'inférence et les charges de travail de raisonnement complexe. Une fois le nouveau cluster opérationnel, Together AI deviendra le principal utilisateur de ces capacités de calcul dédiées. Les étapes suivantes pour les deux parties comprennent le déploiement des serveurs, la construction du réseau Spectrum-X, l'intégration de la plateforme logicielle, les tests du cluster et la mise en service commerciale au premier trimestre 2027.

Ce texte est rédigé, traduit et republié à partir des informations de l'Internet mondial et de partenaires stratégiques, uniquement pour la communication entre lecteurs. En cas d'infraction au droit d'auteur ou d'autres problèmes, veuillez nous en informer à temps pour la modification ou la suppression. La reproduction de cet article est strictement interdite sans autorisation formelle. Mail : news@wedoany.com