Groq, la startup connue pour concevoir ses propres puces d'inférence IA, a levé 350 millions de dollars lors d'un nouveau tour de financement, pour une valorisation de 3,5 milliards de dollars. Cet argent accélérera la transition de l'entreprise d'un simple fabricant de puces vers un fournisseur de « neocloud » qui loue de la puissance de calcul aux développeurs et aux entreprises.
Des puces au cloud
Groq a bâti sa réputation sur des puces sur mesure appelées LPU (language processing units), conçues pour exécuter des charges de travail d'IA plus rapidement et à moindre coût que les puces polyvalentes. L'entreprise visait à défier Nvidia sur l'inférence, le calcul nécessaire pour exécuter des modèles d'IA entraînés en temps réel.
Mais après avoir perdu des membres clés de son équipe de puces, Groq a changé de cap. Au lieu de s'appuyer uniquement sur son propre matériel, elle exploite désormais des centres de données qui combinent des GPU Nvidia avec sa propre technologie. Le nouveau financement soutient « ceux qui cherchent à utiliser des grappes de calcul accéléré Nvidia de taille moyenne et grande pour l'entraînement et l'inférence », a déclaré l'entreprise.
Une empreinte croissante
Groq exploite déjà 13 centres de données en Amérique du Nord, en Europe, au Moyen-Orient et en Asie-Pacifique, au service de plus de 6 millions de développeurs, d'entreprises et de sociétés natives de l'IA. L'entreprise prévoit de faire passer sa capacité électrique de 54 mégawatts à plus de 200 mégawatts d'ici 2027. En juin, elle a levé 650 millions de dollars pour lancer ce virage ; Nvidia figure parmi les investisseurs du nouveau financement.
Le modèle neocloud a suscité un large intérêt alors que la demande de calcul IA dépasse l'offre. Les startups de ce secteur achètent des GPU en gros et revendent l'accès à l'heure, offrant une alternative aux grands clouds publics.
Ce que signifie cet argent
Pour Groq, cette levée de fonds est un pari que le marché veut du choix quant à l'endroit où les modèles d'IA sont exécutés. L'entreprise conserve ses puces d'inférence dans la combinaison, mais ne dépend plus d'elles seules. Le capital supplémentaire lui donne de la marge pour étendre sa capacité tandis que ses rivaux investissent des milliards dans la même course. Alors que les charges de travail d'IA augmentent, la demande de calcul rapide et flexible augmente aussi, et Groq se positionne des deux côtés de ce marché.