Google accélère l'ia : un partenariat stratégique avec marvell

Google ne compte pas laisser Microsoft et Amazon dicter le rythme de l'innovation en matière d'inférence IA. Le géant de la recherche est en négociations avancées avec Marvell Technology pour la conception de deux nouveaux puces dédiées, un geste qui pourrait transformer radicalement la manière dont ses modèles d'IA traduisent la puissance brute en valeur concrète.

Une stratégie de diversification face à la demande croissante

Une stratégie de diversification face à la demande croissante

La dépendance aux fabricants de semi-conducteurs tiers, tels que Broadcom, MediaTek et TSMC, est un point de vulnérabilité pour Google. Ce partenariat avec Marvell vise à réduire cette dépendance, mais surtout à répondre à une demande d'inférence exponentielle. L'inférence, cette phase cruciale où un modèle d'IA entraîné applique ses connaissances à de nouvelles données, est le cœur même de l'intelligence artificielle opérationnelle, et sa performance impacte directement l'expérience utilisateur et la rentabilité des services cloud.

Le premier des deux chips en discussion serait une puce mémoire conçue pour collaborer étroitement avec les TPU (Tensor Processing Units) de Google, les accélérateurs d'IA maison. L'autre, une nouvelle génération de TPU spécifiquement optimisée pour l'inférence. Cette architecture hybride promet une efficacité accrue et une vitesse de traitement considérablement améliorée.

L'arrivée de Ironwood, la septième génération de TPU, disponible depuis novembre, a déjà marqué un tournant. Elle offre un rendement dix fois supérieur à celui des TPU v5p et plus de quatre fois celui des TPU v6e, tant pour l'entraînement que pour l'inférence. L'intégration de jusqu'à 9 216 puces dans un 'superpod', interconnectées via la Technologie de réseau ICI (Inter-Chip Interconnect) à une vitesse fulgurante de 9,6 Tb/s, illustre l'ambition de Google de dominer le marché de la supercalcul IA.

Mais la rivalité s'intensifie. Microsoft, avec sa puce Maia 200, revendique un rendement FP4 trois fois supérieur à celui du Trainium de troisième génération d'Amazon, et un avantage FP8 face aux TPU de Google. Le jeu des chiffres est rude, et chaque entreprise cherche à optimiser son offre pour s’assurer une part du gâteau.

L'enjeu est clair : l'inférence IA n'est plus un simple détail technique, mais le moteur de l'économie numérique. Les entreprises qui maîtriseront ce domaine seront celles qui façonneront l'avenir.

Selon nos sources, les premières puces Marvell pourraient être intégrées aux infrastructures de Google dès l'année prochaine.