OpenAI s'associe à Broadcom et TSMC pour développer sa première puce IA

Dernière mise à jour: 30/10/2024
  • OpenAI s'est associé à Broadcom et TSMC pour concevoir votre première puce intelligence artificielle.
  • L'entreprise a abandonné son projet de construire ses propres usines en raison des coûts élevés.
  • La puce sera axée sur l'inférence IA et devrait se produire en 2026.
  • OpenAI diversifie également son offre avec des puces de Nvidia et AMD pour éviter les pénuries.

puce ouverte

OpenAI , la société à l'origine du célèbre logiciel ChatGPT , collabore avec Broadcom et TSMC pour développer sa propre puce d'intelligence artificielle. Cette initiative s'inscrit dans une nouvelle stratégie visant à réduire sa dépendance vis-à-vis de fournisseurs externes comme Nvidia et à diversifier son approvisionnement en puces, notamment pour répondre à la demande croissante en infrastructures technologiques.

L'entreprise avait initialement envisagé de créer un réseau de fonderies pour produire ses propres puces, mais a finalement renoncé à ce projet coûteux . OpenAI a donc choisi de se concentrer sur la conception interne de ses puces , en s'appuyant sur des tiers comme Broadcom pour la fabrication et en utilisant les installations de TSMC , l'un des géants de la production de semi-conducteurs.

Abandon de sa propre fabrication

Le projet ambitieux d'OpenAI de construire ses propres usines a été abandonné. Selon des sources proches de l'entreprise, cette décision a été prise en raison des coûts extrêmement élevés liés à la mise en place d'une infrastructure de cette envergure. L'investissement initial pour créer ce réseau de fonderies était estimé à plusieurs milliards de dollars, un montant qui s'est avéré non rentable dans un contexte de demande de puces en constante évolution.

puce ouverte

L'entreprise a donc opté pour une approche plus pragmatique : se concentrer sur la conception de puces sur mesure pour ses besoins internes , tout en faisant appel à des fabricants externes pour la production. Cette nouvelle approche permettra à OpenAI de mieux maîtriser ses besoins technologiques sans avoir à gérer l'intégralité du processus de production.

  SoftBank liquide Nvidia et accélère sa transition vers l'IA applicative

La puce d'inférence : un projet prioritaire

La première puce d'OpenAI sera axée sur l'inférence en intelligence artificielle, un domaine dont les analystes prévoient une importance croissante dans les années à venir. L'inférence est le processus par lequel un modèle d'IA entraîné utilise des données pour effectuer des prédictions ou prendre des décisions en temps réel. Face au déploiement croissant d'applications d'IA dans divers secteurs, les entreprises technologiques comme OpenAI ont besoin d'outils plus performants pour traiter rapidement et efficacement de grandes quantités de données.

La collaboration entre Broadcom et OpenAI est en cours depuis plusieurs mois et la première puce devrait être disponible en 2026. La production aura lieu dans les usines de TSMC. Par ailleurs, OpenAI a constitué une équipe spécialisée d'une vingtaine d'ingénieurs , dont certains proviennent d'entreprises comme Google , où ils ont participé au développement des unités de traitement tensoriel (TPU). Thomas Norrie et Richard Ho sont des membres éminents de cette équipe.

Orion, le nouveau modèle d'intelligence artificielle d'OpenAI, arrivera en décembre et promet de révolutionner le marché des entreprises

Relation avec Nvidia et AMD

Bien qu'OpenAI progresse dans la création de sa propre puce, l'entreprise n'a pas pour autant abandonné ses relations avec d'autres géants de la fabrication de semi-conducteurs. Nvidia , réputée pour ses GPU dédiés à l'IA, demeure un partenaire clé. Cependant, OpenAI a commencé à diversifier sa chaîne d'approvisionnement en intégrant des puces comme celles d' AMD , qui seront utilisées via les serveurs cloud Azure de Microsoft.

puce ouverte

La relation avec Nvidia demeure stratégique pour OpenAI, Nvidia dominant le marché avec plus de 80 % de parts de marché dans le domaine des processeurs graphiques (GPU). Cependant, face à la pénurie actuelle de puces et à leurs coûts élevés , OpenAI explore des alternatives. De son côté, AMD prévoit de gagner du terrain sur ce marché grâce à sa nouvelle gamme de puces MI300X, dont la sortie est prévue fin 2023.

  Microsoft Agent Store : qu'est-ce que c'est, comment ça marche et tout ce que vous devez savoir

La stratégie d'OpenAI consistant à « parier sur plusieurs chevaux » lui permettra de gérer plus efficacement les coûts et d'éviter d'éventuels goulots d'étranglement dans l'approvisionnement en puces, qui constituent une ressource cruciale pour la formation et le fonctionnement de ses modèles d'IA.

Coûts de fonctionnement et attentes

Actuellement, les dépenses d'OpenAI sont élevées, les projections indiquant des pertes de 5.000 milliards de dollars pour un chiffre d'affaires de 3.700 milliards cette année. Ces coûts s'expliquent principalement par la puissance de calcul nécessaire à l'entraînement de grands modèles d'IA comme ChatGPT . L'optimisation de l'utilisation des ressources et la recherche de fournisseurs capables de contribuer à la réduction de ces coûts constituent une priorité pour l'entreprise.

Malgré cette situation, OpenAI entretient des relations relativement bonnes avec Nvidia, car elle a toujours besoin d'accéder aux nouvelles générations de puces de ce géant, telles que la série Blackwell , qui devraient révolutionner le marché de l'IA.

Bien qu'OpenAI n'ait pas encore fait de déclaration officielle concernant sa nouvelle puce, les accords conclus avec Broadcom et TSMC témoignent clairement des progrès réalisés par l'entreprise dans ce projet à long terme. Si tout se déroule comme prévu, la première puce conçue spécifiquement par OpenAI pour l'inférence en intelligence artificielle pourrait voir le jour courant 2026, marquant une étape importante dans l'indépendance technologique de l'entreprise.