Home / Affaires et Politique / Amazon entre dans une bataille sérieuse avec Nvidia, prêt à lancer de nouvelles puces d’entraînement AI

Amazon entre dans une bataille sérieuse avec Nvidia, prêt à lancer de nouvelles puces d’entraînement AI

Amazon se prépare à lancer ses dernières puces d’intelligence artificielle alors que les grandes entreprises technologiques cherchent à récupérer leurs milliards de dollars investis dans les semi-conducteurs et à réduire leur dépendance au leader du marché, Nvidia.

Les dirigeants de la division cloud d’Amazon dépensent des sommes considérables pour des puces personnalisées dans l’espoir d’augmenter l’efficacité de leurs dizaines de centres de données, réduisant ainsi leurs propres coûts ainsi que ceux des utilisateurs d’Amazon Web Services (AWS), a rapporté le Financial Times.

À la tête de cette bataille se trouve Annapurna Labs, une startup de fabrication de puces basée à Austin qu’Amazon a acquise au début de 2015 pour 350 millions de dollars. Le dernier produit d’Annapurna devrait être dévoilé le mois prochain lorsque Amazon annoncera la disponibilité générale de ‘Trainium 2’, qui fait partie de sa gamme de puces AI conçues pour entraîner les plus grands modèles.

Trainium 2 est déjà testé par Anthropic, le concurrent d’OpenAI qui a obtenu 4 milliards de dollars de soutien d’Amazon, ainsi que par Databricks, Deutsche Telekom et les entreprises japonaises Ricoh et Stockmark. AWS et Annapurna visent à rivaliser avec Nvidia, l’une des entreprises les plus précieuses au monde en raison de sa domination sur le marché des processeurs AI.

– Nous voulons être le meilleur endroit pour lancer Nvidia, mais en même temps, nous pensons qu’il est sain d’avoir une alternative – a déclaré Dave Brown, vice-président des services de calcul et de mise en réseau chez AWS.

Amazon a déclaré que ‘Inferentia’, une autre de leurs lignes de puces AI spécialisées, est déjà 40 % moins chère à utiliser pour générer des réponses des modèles AI.

– Le coût (de l’informatique en nuage) a tendance à être beaucoup plus élevé en ce qui concerne l’apprentissage automatique et l’intelligence artificielle. Lorsque vous économisez 40 % sur 1 000 dollars, cela n’affecte vraiment pas votre choix. Mais lorsque vous économisez 40 % sur des dizaines de millions de dollars, cela compte – a ajouté Brown.

Amazon s’attend actuellement à environ 75 milliards de dollars de dépenses en capital en 2024, la majeure partie de l’argent étant dirigée vers l’infrastructure technologique. Lors de la dernière conférence téléphonique sur les résultats de l’entreprise, le PDG Andy Jassy a déclaré qu’il s’attend à ce que l’entreprise dépense encore plus en 2025.

Cela représente une augmentation par rapport à 2023, lorsque le géant technologique a dépensé 48,4 milliards de dollars pour l’année entière. Les plus grands fournisseurs de services cloud, y compris Microsoft et Google, sont engagés dans une frénésie de dépenses en intelligence artificielle qui ne montre aucun signe de ralentissement.

Amazon, Microsoft et Meta sont de grands clients des puces de Nvidia, mais conçoivent également leurs propres puces de centre de données pour poser les bases de ce qu’ils espèrent être une vague de croissance AI.

– Tout le monde, d’OpenAI à Apple, veut construire ses propres puces – a noté Daniel Newman du Futurum Group, alors qu’ils cherchent ‘des coûts de production plus bas, des marges plus élevées, une plus grande disponibilité et plus de contrôle’.

– Ce n’est pas seulement une question de puce, mais de tout le système – a déclaré Rami Sinno, directeur de l’ingénierie d’Annapurna et vétéran de SoftBank, Arm et Intel.

Pour l’infrastructure AI d’Amazon, cela signifie construire tout depuis le début, de la puce en silicium aux racks de serveurs dans lesquels ils s’intègrent, le tout soutenu par le propre logiciel et l’architecture d’Amazon.

– C’est vraiment difficile de faire ce que nous faisons à ce niveau. Peu d’entreprises peuvent le faire – a déclaré Sinno.

Après avoir commencé avec le développement d’une puce de sécurité pour AWS appelée Nitro, Annapurna a depuis développé plusieurs générations de Graviton, ses unités centrales de traitement basées sur Arm, qui offrent une alternative à faible consommation aux chevaux de bataille des serveurs traditionnels fournis par Intel ou AMD.

Jusqu’à présent, cependant, AWS et Annapurna ont à peine entamé la domination de Nvidia dans l’infrastructure AI.

Nvidia a rapporté un chiffre d’affaires de 26,3 milliards de dollars provenant des ventes de puces de centres de données AI au cours de son deuxième trimestre fiscal de 2024. Ce chiffre est le même que celui qu’Amazon a rapporté pour l’ensemble de sa division AWS au cours de son deuxième trimestre fiscal – seule une portion relativement petite de cela peut être attribuée aux utilisateurs exécutant AI sur l’infrastructure d’Annapurna, écrit FT.

Quant à la performance ‘brute’ des puces AWS par rapport à celles de Nvidia, Amazon évite les comparaisons directes et ne soumet pas ses puces à des benchmarks de performance indépendants. Patrick Moorhead, consultant en puces chez Moor Insights & Strategy, a déclaré qu’il est convaincu que les affirmations d’Amazon concernant une augmentation de performance quadruple entre Trainium 1 et Trainium 2 sont exactes, car il a observé de près l’entreprise pendant des années, mais les données de performance peuvent être moins importantes que de simplement fournir aux clients plus de choix.

– Les gens apprécient toutes les innovations que Nvidia a apportées, mais personne n’est à l’aise avec le fait que Nvidia détienne 90 % de part de marché. Cela ne peut pas durer longtemps – conclut Moor.