IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)
Navigation

Inscrivez-vous gratuitement
pour pouvoir participer, suivre les réponses en temps réel, voter pour les messages, poser vos propres questions et recevoir la newsletter

Intelligence artificielle Discussion :

OpenAI et Broadcom dévoilent « Jalapeño », la première puce d'inférence IA sur mesure d'OpenAI


Sujet :

Intelligence artificielle

  1. #1
    Chroniqueur Actualités
    Avatar de Anthony
    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Novembre 2022
    Messages
    2 284
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Gironde (Aquitaine)

    Informations professionnelles :
    Activité : Rédacteur technique

    Informations forums :
    Inscription : Novembre 2022
    Messages : 2 284
    Par défaut OpenAI et Broadcom dévoilent « Jalapeño », la première puce d'inférence IA sur mesure d'OpenAI
    OpenAI, le propriétaire de ChatGPT, envisage de fabriquer ses propres puces d'intelligence artificielle

    OpenAI, la société à l'origine de ChatGPT, envisage de fabriquer ses propres puces d'intelligence artificielle et est allée jusqu'à évaluer une cible d'acquisition potentielle, selon des personnes au fait des projets de la société.

    L'entreprise n'a pas encore décidé d'aller de l'avant, selon des discussions internes récentes. Cependant, depuis au moins l'année dernière, elle a discuté de diverses options pour résoudre la pénurie de puces d'IA coûteuses sur lesquelles OpenAI s'appuie, selon des personnes familières avec le sujet.

    Ces options comprenaient la construction de sa propre puce d'IA, une collaboration plus étroite avec d'autres fabricants de puces, y compris NVIDIA, et la diversification de ses fournisseurs au-delà de NVIDIA.

    Le PDG Sam Altman a fait de l'acquisition d'un plus grand nombre de puces d'IA une priorité absolue pour l'entreprise. Il s'est publiquement plaint de la pénurie d'unités de traitement graphique, un marché dominé par NVIDIA, qui contrôle plus de 80 % du marché mondial des puces les mieux adaptées à l'exécution des applications d'IA.


    Les efforts déployés pour obtenir davantage de puces sont liés à deux problèmes majeurs identifiés par M. Altman : une pénurie de processeurs avancés qui alimentent les logiciels d'OpenAI et les coûts "exorbitants" associés à l'exploitation du matériel nécessaire pour faire fonctionner ses efforts et ses produits.

    Depuis 2020, OpenAI a développé ses technologies d'intelligence artificielle générative sur un supercalculateur massif construit par Microsoft, l'un de ses principaux bailleurs de fonds, qui utilise 10 000 unités de traitement graphique (GPU) de NVIDIA.

    L'exploitation de ChatGPT est très coûteuse pour l'entreprise. Chaque requête coûte environ 4 cents, selon une analyse de Stacy Rasgon, analyste chez Bernstein. Si les requêtes de ChatGPT atteignent un dixième de l'échelle de recherche de Google, il faudra environ 48,1 milliards de dollars de GPU au départ et environ 16 milliards de dollars de puces par an pour rester opérationnel.

    L'ère des puces personnalisées

    Un effort pour développer ses propres puces d'IA placerait OpenAI dans un petit groupe de grands acteurs technologiques tels que Google d'Alphabet et Amazon.com qui ont cherché à prendre le contrôle de la conception des puces qui sont fondamentales pour leurs activités.

    Il n'est pas certain qu'OpenAI aille de l'avant avec son projet de construction d'une puce personnalisée. Il s'agirait d'une initiative stratégique majeure et d'un investissement lourd qui pourrait représenter des centaines de millions de dollars par an, selon des vétérans de l'industrie. Même si OpenAI consacrait des ressources à cette tâche, le succès ne serait pas garanti.

    L'acquisition d'un fabricant de puces pourrait accélérer le processus de construction de la propre puce d'OpenAI - comme cela a été le cas pour Amazon.com et son acquisition d'Annapurna Labs en 2015.

    OpenAI a envisagé cette voie au point d'effectuer des vérifications préalables sur une cible d'acquisition potentielle, selon l'une des personnes familières avec ses plans. Mais il n'a pas été possible de connaître l'identité de l'entreprise qu'OpenAI a envisagé d'acheter.

    Même si OpenAI va de l'avant avec ses plans pour une puce personnalisée - y compris une acquisition - l'effort est susceptible de prendre plusieurs années, laissant la société dépendante des fournisseurs commerciaux comme NVIDIA et Advanced Micro Devices dans ce laps de temps.

    Certaines grandes entreprises technologiques construisent leurs propres processeurs depuis des années, avec des résultats limités. Les efforts de Meta en matière de puces personnalisées se sont heurtés à des problèmes, ce qui a conduit l'entreprise à mettre au rebut certaines de ses puces d'IA. Le propriétaire de Facebook travaille actuellement sur une nouvelle puce qui couvrira tous les types de travaux d'IA.

    Le principal bailleur de fonds d'OpenAI, Microsoft, développe également une puce d'IA personnalisée qu'OpenAI est en train de tester. Ces projets pourraient être le signe d'une plus grande distance entre les deux entreprises.

    La demande de puces d'IA spécialisées est montée en flèche depuis le lancement de ChatGPT l'année dernière. Les puces spécifiques, ou accélérateurs d'IA, sont nécessaires pour former et faire fonctionner les dernières technologies d'IA générative. NVIDIA est l'un des rares fabricants de puces à produire des puces d'IA utiles et à dominer le marché.

    Source : OpenAI, la société à l'origine de ChatGPT

    Et vous ?

    Quel est votre avis sur le sujet ?

    Trouvez-vous que cette initiative d'OpenAI est cohérente et pertinente ?

    Voir aussi

    OpenAI met sur pieds une division chargée de créer une IA qui va contrôler le développement de la superintelligence, supposée être plus intelligente que l'homme. Elle pourrait arriver d'ici 2030

    Nvidia dévoile une nouvelle puce d'IA, le NVIDIA DGX GH200, et affirme que les coûts d'exploitation des LLM vont « baisser de manière significative »

    La puce d'IA Nvidia H100 à 40 000 dollars est devenue le matériel informatique le plus convoité au monde et rapproche Nvidia des 1 000 milliards de dollars de capitalisation boursière

    OpenAI, la startup à l'origine de ChatGPT, pourrait être valorisée jusqu'à 90 milliards de dollars, si l'opération de vente des actions détenues par les salariés se concrétise
    Contribuez au club : corrections, suggestions, critiques, ... Contactez le service news et Rédigez des actualités

  2. #2
    Chroniqueur Actualités

    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Juin 2023
    Messages
    1 958
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : Bénin

    Informations professionnelles :
    Activité : Rédacteur technique
    Secteur : High Tech - Éditeur de logiciels

    Informations forums :
    Inscription : Juin 2023
    Messages : 1 958
    Par défaut Sam Altman, PDG d'OpenAI, envisage de créer ses propres processeurs d'IA afin de rivaliser avec Nvidia
    Sam Altman serait en pourparlers avec les Émirats arabes unis et TSMC dans le cadre d'un projet visant à créer ses propres puces d'IA pour répondre aux besoins d'OpenAI
    et rivaliser avec Nvidia

    Sam Altman, PDG d'OpenAI, serait en pourparlers avec TSMC et des bailleurs de fonds du Moyen-Orient dans le cadre d'une initiative visant à créer sa propre puce d'IA. Le projet vise à répondre aux besoins croissants d'OpenAI en semiconducteurs et à réduire sa dépendance à l'égard de Nvidia, dont les accélérateurs d'IA figurent parmi les composants informatiques les plus convoités dans l'industrie ces dernières années. Si les discussions aboutissent, cela permettrait à OpenAI de mettre en place un réseau d'usines de fabrication de puces d'IA qui, selon les indiscrétions, devraient être capables de rivaliser avec les puces de Nvidia.

    Sam Altman veut lancer OpenAI sur le marché de la conception et de la fabrication de puces d'IA et chercherait des partenaires. Des personnes au fait du projet rapportent qu'Altman est en pourparlers avec certaines des personnes les plus riches et les plus influentes du Moyen-Orient, dont le cheikh Tahnoon bin Zayed al-Nahyan, conseiller à la sécurité nationale des Émirats arabes unis et président de plusieurs fonds d'investissement publics et sociétés d'IA. Altman recherche des fonds pour son nouveau projet ambitieux de développement et de fabrication de puces conçues pour l'entraînement et la construction de systèmes d'IA.

    En plus des investisseurs, Altman discuterait également d'un éventuel partenariat avec le fabricant taïwanais de puces TSMC (Taiwan Semiconductor Manufacturing Company). (TSMC est le plus grand fabricant de micropuces sous contrat au monde. Il contrôle plus de la moitié de la production mondiale de puces utilisées dans tous les domaines, des smartphones aux missiles.) Mais ni OpenAI ni TSMC n'ont commenté l'affaire, et Sheikh Tahnoon n'a pas été en mesure de le faire. Bloomberg a d'abord rapporté que Altman était à la recherche d'une entreprise de fabrication de puces avec des investisseurs du Moyen-Orient.


    Selon des personnes au fait des plans d'Altman, il aurait approché plusieurs banques d'investissement, notamment SoftBank, basée au Japon, pour l'aider à concrétiser ce projet. Pour rappel, le cheikh Tahnoon préside l'Abu Dhabi Investment Authority et de l'ADQ (une entité d'investissement de l'État), l'International Holding Company, un conglomérat tentaculaire qui est rapidement devenu la plus grande société cotée des Émirats arabes unis, et G42, une ambitieuse société d'IA qui a conclu des partenariats avec Microsoft et OpenAI. Mais aucune de ces entreprises n'a ni confirmé ni infirmé la rumeur sur les pourparlers.

    OpenAI, Meta, Microsoft, Amazon et d'autres entreprises qui développent des outils d'IA à la pointe de la technologie sont toutes dépendantes des puces d'IA de Nvidia. La situation est telle que Nvidia a du mal à faire face à la demande pour ses accélérateurs d'IA H100 destinés au développement de l'IA et au calcul haute performance (HPC). Il existe des alternatives aux puces d'IA de Nvidia, mais avec des performances inférieures. Les accélérateurs d'IA de Nvidia ont été l'épine dorsale de la révolution de l'IA, car ils offrent des performances et une efficacité élevées pour l'exécution de réseaux neuronaux à grande échelle.

    Le mois dernier, Omdia a rapporté que la demande pour ces processeurs d'IA de Nvidia est si élevée que le délai d'approvisionnement des serveurs basés sur le H100 est de 36 à 52 semaines. S'il n'y a pas suffisamment de puces pour former et faire fonctionner les modèles afin de répondre à la demande des utilisateurs, les services à distance peuvent souffrir de ralentissements, de rationnement ou d'un déploiement limité, ce qui n'est pas une bonne expérience pour le client. Ceux qui espèrent utiliser la technologie sur leur propre infrastructure risquent de ne pas pouvoir se procurer facilement les pièces dont ils ont besoin.

    L'analyse indique que Meta et Microsoft sont les plus gros acheteurs, ces entreprises ayant acheté chacune jusqu'à 150 000 GPU H100. C'est nettement supérieur au nombre de puces d'IA H100 achetées par Google, Amazon, Oracle et Tencent (50 000 chacun). Selon certaines sources, Meta vient d'indiquer qu'il veut 350 000 accélérateurs Nvidia d'ici la fin de l'année pour mener à bien ses travaux sur l'AGI. Les entreprises luttent pour avoir ces processeurs d'IA. Selon les analystes, l'IA restera d'actualité en 2024, mais l'insuffisance de l'approvisionnement en silicium risque d'entraver les déploiements à grande échelle.

    Altman espère défier Nvidia, qui domine le marché des puces d'IA avec une valeur de marché de près de 1 500 milliards de dollars. Il veut être le capitaine de sa propre usine de fabrication de puces d'IA. Selon les analystes, avec pour objectif de créer des usines de conception et de fabrication de puces d'IA pour piloter la prochaine génération de modèles d'IA d'OpenAI, Altman vise définitivement les étoiles. L'on ignore combien Altman cherche à lever, mais la conception et la fabrication de puces sont très complexes et très coûteuses et tenter de concurrencer Nvidia, risque de saigner plusieurs dizaines de milliards de dollars.

    Le financement d'un seul projet d'usine - sans parler d'un réseau d'installations - ne sera ni facile ni bon marché. Une seule usine de fabrication de puces peut coûter entre 10 et 20 milliards de dollars, en fonction de l'emplacement et de la capacité prévue. Les deux usines d'Intel en Arizona devraient coûter 15 milliards de dollars chacune, tandis que TSMC s'attend à ce que son projet d'usine, situé à proximité, s'élève à environ 40 milliards de dollars. De plus, la construction de ces installations peut durer de quatre à cinq ans, à condition que certains problèmes, comme la pénurie de main-d'œuvre, n'entraînent pas des retards.

    D'autres sources rapportent qu'il ne semble pas qu'OpenAI cherche à entrer dans le jeu des fonderies. Il semble plutôt que le plan consiste à canaliser les fonds collectés vers des fabricants de puces de pointe tels que TSMC, Samsung et, éventuellement, Intel. En fait, OpenAI rassemblerait des milliards pour que ces géants de la fabrication produisent des pièces pour l'IA. TSMC serait le principal candidat, car les GPU et les accélérateurs d'IA de Nvidia, AMD et Intel sont tous fabriqués dans les usines de l'entreprise taïwanaise. (Nvidia a déjà utilisé les installations de Samsung pour certaines de ses pièces de dernière génération.)

    Nvidia est un acteur établi et ses processeurs d'IA sont aujourd'hui plus convoités que jamais. Bien que Nvidia soit de plus en plus talonné par son concurrent AMD sur le marché des puces d'IA, il détient toujours une grosse part du marché des processeurs d'IA. AMD a lancé le mois dernier un nouvel accélérateur d'IA appelé "Instinct MI300X". Lisa Su, PDG d'AMD, et ses collègues ont présenté les prouesses du MI300X en le comparant aux performances d'inférence du H100 de Nvidia à l'aide de Llama 2. La puce d'AMD devrait coûter moins cher que les produits concurrents de Nvidia, dont le prix peut atteindre 40 000 dollars l'unité.

    Microsoft et Meta ont annoncé qu'ils achèteront le nouvel accélérateur d'IA MI300X d'AMD afin de réduire leur dépendance à l'égard du matériel de Nvidia. Ce qui annonce une rivalité intense. Des rapports ont également signalé qu'OpenAI aurait signé une lettre d'intention dans laquelle il s'est engagé à acheter pour 51 millions de dollars de puces d'IA à une startup nommée Rain AI. Cet investissement a été présenté par OpenAI comme un moyen de réduire sa dépendance à l'égard des processeurs d'IA de Nvidia. Mais selon certaines sources, l'accord suscite des controverses, car Altman a investi à titre personnel dans Rain AI.

    Il reste à déterminer si l'entreprise de puces d'Altman sera une filiale d'OpenAI ou une entité distincte. Selon certaines sources, OpenAI sera le principal client de la nouvelle société, ce qui pourrait lui donner un avantage sur ses rivaux dans le domaine de l'IA. Altman, qui a cofondé OpenAI en 2015, est connu pour ses idées audacieuses et controversées. Il a été brièvement évincé de son poste de PDG d'OpenAI en novembre dernier après que le conseil d'administration l'a accusé de ne pas avoir été honnête avec lui. Mais après une réaction brutale des employés et des investisseurs, il a été rétabli dans ses fonctions au bout d'une semaine.

    La nouvelle entreprise d'Altman dans le domaine des puces électroniques est un autre exemple de ses plans audacieux et ambitieux pour façonner l'avenir de l'IA. Reste à savoir s'il parviendra à s'imposer face à Nvidia et à créer son empire des puces. Beaucoup sont sceptiques quant à la réussite du projet. D'autres estiment que le projet pourrait devenir un sujet de conflit entre Altman et le gouvernement fédéral américain. « Le gouvernement fédéral va intervenir si c'est vrai. L'administration Biden veut VRAIMENT empêcher la Chine d'obtenir ce type de puces et les Émirats arabes unis sont assez proches de la Chine », note un critique.

    Et vous ?

    Quel est votre avis sur le sujet ?
    L'initiative de Sam Altman sur le marché des puces a-t-elle des chances d'aboutir ?
    Que pensez-vous des partenaires potentiels avec lesquels Sam Altman serait actuellement en pourparlers ?
    Pensez-vous que le gouvernement américain s'opposerait au projet afin d'empêcher la Chine d'avoir accès à ces puces ?

    Voir aussi

    OpenAI, le propriétaire de ChatGPT, envisage de fabriquer ses propres puces d'intelligence artificielle

    La puce d'IA Nvidia H100 à 40 000 dollars est devenue le matériel informatique le plus convoité au monde et rapproche Nvidia des 1 000 milliards de dollars de capitalisation boursière

    Nvidia vient d'engranger 6 milliards de dollars de bénéfices grâce à la montée en puissance de l'IA, la croissance explosive de Nvidia est propulsée par sa puce H100 destinée à la formation de l'IA

  3. #3
    Communiqués de presse

    Femme Profil pro
    Traductrice Technique
    Inscrit en
    Juin 2023
    Messages
    2 986
    Détails du profil
    Informations personnelles :
    Sexe : Femme
    Localisation : France

    Informations professionnelles :
    Activité : Traductrice Technique

    Informations forums :
    Inscription : Juin 2023
    Messages : 2 986
    Par défaut Sam Altman cherche des milliards pour financer des puces pour l'IA
    Sam Altman cherche des milliers de milliards de dollars pour financer des puces d'IA, et discute de projets "extrêmement ambitieux" avec des investisseurs, dont les Émirats arabes unis.

    Le PDG d'OpenAI, Sam Altman, cherche à lever des milliers de milliards de dollars auprès d'investisseurs, dont le gouvernement des Émirats arabes unis, afin de renforcer la capacité mondiale à produire des puces avancées et à alimenter l'intelligence artificielle, a rapporté le Wall Street Journal.

    L'initiative technologique extrêmement ambitieuse de Sam Altman pourrait nécessiter de lever jusqu'à 7 000 milliards de dollars, a rapporté le Wall Street Journal, citant des personnes familières avec le dossier. Dans le cadre de son discours aux investisseurs, M. Altman a proposé de construire des dizaines de fonderies de puces qui seraient ensuite gérées par des fabricants de puces existants, tels que Taiwan Semiconductor Manufacturing Company (TSMC), a indiqué le journal.

    Les plans visent à résoudre les obstacles à la croissance d'OpenAI, notamment la pénurie de puces qui alimentent les modèles d'IA tels que ChatGPT, selon le WSJ, qui a décrit les sommes recherchées comme "outlandishly large by the standards of corporate fundraising" (littéralement "ridiculement grandes par rapport aux normes de collecte de fonds des entreprises").

    Selon le rapport, les projets d'Altamn l'ont amené à rencontrer de hauts fonctionnaires des Émirats arabes unis, des cadres de TSMC, la secrétaire américaine au commerce Gina Raimondo et le directeur général de SoftBank, Masayoshi Son.


    Alors que de nombreux pays ont annoncé leur intention de soutenir la production nationale de semi-conducteurs, l'offre mondiale est toujours dominée par une poignée d'entreprises, dont Taiwan Semiconductor Manufacturing Company (TSMC) et la société californienne NVIDIA.

    Un porte-parole d'OpenAI, cité par le WSJ, a déclaré que l'entreprise avait eu des "discussions productives sur l'augmentation de l'infrastructure mondiale et des chaînes d'approvisionnement" et qu'elle donnerait plus de détails à une date ultérieure.

    À la tête d'OpenAI, M. Altman est devenu l'un des visages les plus reconnaissables dans le domaine florissant de l'IA. En novembre, l'entrepreneur de 38 ans a été licencié de la start-up qu'il avait cofondée, avant d'être réintégré quelques jours plus tard à la suite de protestations d'employés et d'investisseurs.

    Source : The Wall Street Journal

    Et vous ?

    Quel est votre avis sur le sujet ?

    Voir aussi :

    Sam Altman serait en pourparlers avec les Émirats arabes unis et TSMC dans le cadre d'un projet visant à créer ses propres puces d'IA pour répondre aux besoins d'OpenAI et rivaliser avec Nvidia

    Sam Altman : le PDG d'OpenAI estime que d'autres percées technologiques sont nécessaires pour atteindre l'IAG, le niveau d'IA capable de réaliser toutes les tâches intellectuelles humaines

    OpenAI a accepté d'acheter pour 51 millions de dollars de puces d'IA à une startup soutenue par le PDG Sam Altman, mais les critiques affirment qu'il s'agit d'une situation de conflit d'intérêts
    Publication de communiqués de presse en informatique. Contribuez au club : corrections, suggestions, critiques, ... Contactez le service news et Rédigez des actualités

  4. #4
    Chroniqueur Actualités

    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Juin 2023
    Messages
    1 958
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : Bénin

    Informations professionnelles :
    Activité : Rédacteur technique
    Secteur : High Tech - Éditeur de logiciels

    Informations forums :
    Inscription : Juin 2023
    Messages : 1 958
    Par défaut Le PDG de Nvidia estime que le rêve de Sam Altman visant à lever 7 000 Mds $ est très éloigné de la réalité
    Le PDG de Nvidia estime que le rêve de Sam Altman visant à lever 7 000 milliards de dollars pour fabriquer ses propres puces d'IA est très éloigné de la réalité
    le projet suscite le scepticisme

    Le PDG de Nvidia, Jensen Huang, tacle Sam Altman au sujet de son projet inédit visant à lever des milliers de milliards de dollars pour construire un réseau d'usines de fabrication de puces d'IA à travers le monde. La rumeur indique que Sam Altman cherche à lever jusqu'à 7 000 milliards de dollars et serait déjà en pourparlers avec de nombreux investisseurs. Mais, Jensen Huang, qui dirige Nvidia depuis sa création en avril 1993, pense que ce rêve est complètement loufoque. Il estime que cet argent permettrait d'acheter toutes les entreprises importantes de fabrication de puces, mais que le développement de l'IA ne se limite pas à accumuler de la puissance de calcul.

    Le bruit court depuis l'année dernière qu'OpenAI veut se défaire de sa dépendance à Nvidia. Et le plan du PDG Sam Altman pour y arriver consiste à construire un réseau d'usines pour fabriquer ses propres puces d'IA. Un récent rapport sur le sujet indique qu'Altman tente de réunir entre 5 000 et 7 000 milliards de dollars pour mener à bien son projet, une somme colossale qui donne lieu à de nombreux commentaires et spéculations. Altman aurait déjà approché des partenaires comme G42, basé à Abou Dhabi, et SoftBank, au Japon. Rappelons que Microsoft est actuellement le principal bailleur de fonds d'OpenAI.

    Cependant, Jensen Huang de Nvidia trouve l'idée complètement absurde et s'en est moqué. Lors d'une apparition au Sommet mondial des gouvernements (WGS) lundi à Dubaï, Huang a déclaré que 7 000 milliards de dollars permettraient d'acheter apparemment tous les GPU. Huang a fait cette boutade lorsqu'Omar Sultan Al Olama, le ministre d'État des Émirats arabes unis chargé de l'IA, de l'économie numérique et des applications de travail à distance, lui a demandé combien de GPU cet argent pourrait acheter. Il pense que le développement de l'IA ne coûterait pas autant que l'argent qu'Altman cherche à réunir.


    Pour mettre ce chiffre en perspective, cela représente près de 14 fois le revenu total de l'ensemble du marché des semiconducteurs l'année dernière. D'après Gartner, le chiffre d'affaires mondial des fournisseurs de semiconducteurs devrait atteindre 533 milliards de dollars en 2023. Et en dépit de tout le battage médiatique autour de l'IA générative, les analystes s'attendent à ce que ce chiffre d'affaires augmente de 17 % pour atteindre 624 milliards de dollars cette année. Même en supposant que les besoins en puissance de calcul augmentent en flèche, les analystes trouvent que ce montant est nettement exagéré.

    Selon le PDG de Nvidia, le tout n'est pas d'acheter des tonnes de GPU. « Vous ne pouvez pas vous contenter d'acheter plus d'ordinateurs. Vous devez également supposer que les ordinateurs deviendront plus rapides et que, par conséquent, la quantité totale dont vous avez besoin sera moins importante », a déclaré Huang. L'homme d'affaires américain a également suggéré que le coût de la construction de centres de données d'IA sur le plan mondial s'élèverait à 2 000 milliards de dollars d'ici 2029. Selon lui, il existe une base installée de centres de données d'une valeur d'environ 1 000 milliards de dollars.

    « Au cours des quatre ou cinq prochaines années, nous aurons des centres de données d'une valeur de 2 000 milliards de dollars qui alimenteront des logiciels dans le monde entier », a ajouté Huang. À l'heure actuelle, Nvidia domine largement le marché mondial des puces d'IA. Nvidia fournit des puces d'IA à presque toutes les entreprises d'IA, en particulier Microsoft, Google, OpenAI et Meta. La demande exceptionnelle pour les puces d'IA de Nvidia a rendu l'entreprise très riche et l'a propulsée au rang de la quatrième entreprise la plus précieuse du monde, après Microsoft, Apple et le géant saoudien Aramco.

    De nombreux experts ont spéculé sur ce qu'Altman pourrait faire avec 7 000 milliards de dollars. Cela représente assez d'argent pour engloutir Nvidia, TSMC, Broadcom, ASML, Samsung, AMD, Intel, Qualcomm et tous les autres fabricants de semiconducteurs, concepteurs, détenteurs de propriété intellectuelle et vendeurs d'équipements importants dans leur intégralité. Après quoi, il restera encore des milliers de milliards de dollars. Mais il serait impossible pour Altman d'envisager cette possibilité, car les régulateurs étatiques mettraient leurs vétos à cette initiative pour des raisons évidentes de concurrence.

    En effet, nous pouvons imaginer bien d'autres façons de dépenser ce genre d'argent. Quoi qu'il en soit, 7 000 milliards de dollars restent une somme énorme à dépenser pour des usines, même un réseau d'usines. Aujourd'hui, les analystes estiment que le coût d'une usine de fabrication de puces de pointe se situerait entre 10 et 30 milliards de dollars, en fonction de la taille du site et de son emplacement. En supposant que les installations envisagées par Altman coûteraient en moyenne 20 milliards de dollars, 7 000 milliards de dollars correspondraient à environ 350 sites de fonderie répartis à travers le monde.

    En outre, l'été dernier, la Semiconductor Industry Association (SIA) et la société britannique Oxford Economics ont averti que l'industrie américaine des semiconducteurs risquait de manquer de 67 000 techniciens, ingénieurs et informaticiens d'ici à 2030. Intel, qui est le fer de lance de l'un des plus grands projets américains de construction d'usines de puces, estime que ce chiffre sera plus proche de 70 000 à 90 000 au cours des prochaines années. Et cela ne concerne qu'une poignée d'usines en cours de développement aux États-Unis. Le projet d'Altman pourrait manquer cruellement de main-d'œuvre.

    Il n'est pas nécessaire de faire preuve de beaucoup d'imagination pour comprendre que 350 sites supplémentaires seraient problématiques à l'échelle mondiale. Comme si cela ne suffisait pas, la demande de semiconducteurs a tendance à fluctuer de manière cyclique. Les frénésies d'achat sont généralement suivies de longs cycles de digestion, et les hausses des ventes de PC tendent à coïncider avec les sorties de systèmes d'exploitation ou de logiciels. La rumeur indique qu'OpenAI veut rivaliser avec Nvidia, ce qui signifie que les usines serviront le monde de l'IA en général, mais aussi tout ce qui s'y rattache.

    Les usines pourraient se retrouver en grande difficulté lorsque la demande pour les puces d'IA reviendrait à la baisse. Le marché des puces de mémoire se remet à peine d'une surabondance de stock qui a fait chuter les prix de vente moyens à des niveaux historiquement bas. Entre-temps, Intel aurait reporté la date d'achèvement de ses usines de l'Ohio à la fin de 2026, en raison des faiblesses actuelles du marché des puces et des retards dans l'obtention du financement au titre de la loi américaine CHIPS and Science Act, qui prévoit un financement global de 53 milliards de dollars pour la construction d'usines de puces.

    Enfin de compte, les analystes estiment que les 7 000 milliards de dollars utilisés pour décrire l'ampleur des ambitions d'Altman sont soit des hyperboles, soit une partie d'un plan plus vaste et plus holistique. En outre, il s'agit d'une rumeur que l'intéressé lui-même se garde de commenter pour l'instant.

    Et vous ?

    Quel est votre avis sur le sujet ?
    Que pensez-vous des déclarations de Jensen Huang sur le projet de Sam Altman ?
    Selon vous, Altman est-il capable de réunir 7 000 milliards de dollars pour son projet ?
    Pensez-vous que cette somme est exagérée ? Altman est-il en mesure de rivaliser avec Nvidia ?
    Quels impacts une telle levée de fonds pourrait avoir sur l'ensemble de l'industrie technologique ?

    Voir aussi

    OpenAI, le propriétaire de ChatGPT, envisage de fabriquer ses propres puces d'intelligence artificielle

    Sam Altman cherche des milliers de milliards de dollars pour financer des puces d'IA et discute de projets "extrêmement ambitieux" avec des investisseurs, dont les Émirats arabes unis

    « GPT-5 sera plus intelligent, plus rapide, plus polyvalent et meilleur dans toutes les tâches que GPT-4 », affirme Sam Altman, qui appelle une nouvelle fois à une réglementation mondiale sur l'IA

  5. #5
    Chroniqueur Actualités
    Avatar de Anthony
    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Novembre 2022
    Messages
    2 284
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Gironde (Aquitaine)

    Informations professionnelles :
    Activité : Rédacteur technique

    Informations forums :
    Inscription : Novembre 2022
    Messages : 2 284
    Par défaut OpenAI s'associe à TSMC pour développer ses propres puces d'IA, conçues avec Broadcom
    OpenAI s'associe à TSMC pour développer ses propres puces d'IA, conçues avec Broadcom, qui se concentreront dans un premier temps sur l'exécution de modèles d'IA plutôt que sur leur entraînement

    OpenAI aurait conclu un partenariat avec le rival de Samsung, Taiwan Semiconductor Manufacturing Co (TSMC), pour développer sa première génération de puces d'intelligence artificielle en interne. Selon Reuters, l'entreprise technologique s'efforce de réduire sa dépendance à l'égard de Nvidia et devrait finaliser la conception de son silicium dans les mois à venir.

    Cette initiative fait suite aux échanges entre Sam Altman, PDG d'OpenAI, et TSMC ainsi que des bailleurs de fonds des Emirats arabes unis dans le cadre d'un projet visant à créer ses propres puces d'IA pour répondre aux besoins d'OpenAI et rivaliser avec Nvidia.


    Nvidia détient une part importante du marché des puces d'IA pour l'entraînement et le déploiement de modèles tels que le GPT d'OpenAI. Mais dépendre d'un seul fournisseur a ses inconvénients, ce qui pousse les entreprises technologiques à explorer d'autres options, que ce soit par le biais de partenariats ou en construisant leurs propres processeurs.

    De surcroît, le coût de l'entraînement et de l'exploitation des modèles d'IA ne cesse d'augmenter. Les entreprises qui travaillent sur de grands modèles de langage (LLM) ont besoin d'une puissance de calcul considérable, certains projets utilisant des milliers de processeurs. On estime que la formation de modèles tels que le GPT-4 coûte à elle seule des centaines de millions de dollars en matériel.

    La décision a été prise après que Sam Altman, PDG d'OpenAI, a rencontré Jay Y. Lee, président de Samsung Electronics, la semaine dernière, dans le but de mettre en place un partenariat ouvert dans lequel les deux entreprises se soutiendraient mutuellement.

    OpenAI et le programme de puce d'IA à petite échelle de TSMC

    L'équipe interne d'OpenAI, dirigée par Richard Ho, est en train de concevoir la puce en collaboration avec Broadcom. L'équipe aurait doublé de taille au cours des derniers mois, passant à 40 personnes. Richard Ho, qui a rejoint OpenAI il y a plus d'un an, travaillait auparavant chez Google, la société d'Alphabet, où il a joué un rôle clé dans le programme de puces d'IA personnalisées de l'entreprise.

    Reuters rapporte que l'équipe de Richard Ho est plutôt petite comparée aux opérations massives des géants de la technologie comme Google et Amazon. La conception d'une nouvelle puce pour un projet important et ambitieux pourrait coûter à l'entreprise 500 millions de dollars pour une seule version.

    La puce d'IA interne d'OpenAI serait capable de gérer à la fois l'entraînement et l'exécution de modèles d'IA, mais dans un premier temps, elle sera déployée à une échelle limitée, principalement pour l'exécution de modèles, ont indiqué des sources au média. Elle ne jouera pas encore un rôle important dans l'infrastructure globale de l'entreprise.

    La puce serait fabriquée par TSMC en utilisant son processus de pointe de 3 nanomètres. Elle est dotée d'une architecture systolique, très répandue dans les puces d'intelligence artificielle, d'une mémoire à large bande passante (HBM) - la même technologie que celle utilisée par Nvidia - et de capacités de mise en réseau avancées.

    Malgré les progrès sur les matériels d'IA, des inquiétudes persistent quant à l'impact environnemental de la technologie. Les experts avertissent que ces systèmes consomment de grandes quantités d'énergie et d'eau, certains émettant plusieurs tonnes de CO2 par jour.

    Sasha Luccioni, chercheuse en IA, a notamment déclaré que l'IA générative accélère la crise climatique en raison de sa forte consommation d'énergie. Elle a également ajouté qu'il est particulièrement décevant que les gens utilisent l'IA pour faire des recherches sur Internet alors que ces recherches consomment à elles seules 30 fois plus d'énergie que les moteurs de recherche traditionnels.

    Source : Reuters

    Et vous ?

    Quel est votre avis sur le sujet ?
    Trouvez-vous cette initiative d'OpenAI crédible ou pertinente ?

    Voir aussi :

    OpenAI, le propriétaire de ChatGPT, envisage de fabriquer ses propres puces d'intelligence artificielle

    Le patron de TSMC prévoit une pénurie de puces d'IA jusqu'en 2025 et affirme que les commentaires de Trump ne changent rien à sa stratégie initiale d'expansion d'usines à l'étranger
    Contribuez au club : corrections, suggestions, critiques, ... Contactez le service news et Rédigez des actualités

  6. #6
    Communiqués de presse

    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Avril 2025
    Messages
    811
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Paris (Île de France)

    Informations professionnelles :
    Activité : Rédacteur technique

    Informations forums :
    Inscription : Avril 2025
    Messages : 811
    Par défaut OpenAI prévoit de lancer la production en série de sa propre puce IA personnalisée l'année prochaine
    OpenAI prévoit de lancer la production en série de sa propre puce IA personnalisée l'année prochaine, conçue en partenariat avec Broadcom, elle ne sera pas commercialisée, mais utilisée en interne par OpenAI.

    OpenAI prévoit de lancer la production en série de sa propre puce IA personnalisée l'année prochaine. Ces puces, qui ont été conçues en partenariat avec Broadcom, seront utilisées en interne par OpenAI, plutôt que d'être mises à la disposition de clients externes. Selon des rumeurs persistantes, OpenAI travaillerait depuis longtemps avec Broadcom pour développer son propre semi-conducteur personnalisé pour l'entraînement et l'inférence de l'IA, l'entreprise ayant élargi son équipe dédiée aux semi-conducteurs ces dernières années pour soutenir cet effort.

    En février, un rapport a révélé qu'OpenAI aurait conclu un partenariat avec le rival de Samsung, Taiwan Semiconductor Manufacturing Co (TSMC), pour développer sa première génération de puces d'intelligence artificielle (IA) en interne. Selon le rapport, l'entreprise technologique s'efforce de réduire sa dépendance à l'égard de Nvidia et devrait finaliser la conception de son silicium dans les mois à venir.

    Un nouveau rapport vient de révéler qu'OpenAI prévoit de lancer la production en série de sa propre puce IA personnalisée l'année prochaine. Ces puces, qui ont été conçues en partenariat avec Broadcom, seront utilisées en interne par OpenAI, plutôt que d'être mises à la disposition de clients externes.

    Cette information a été révélée après que le PDG de Broadcom, Hock Tan, ait déclaré aux analystes, le jeudi 4 septembre, que la société avait trouvé un quatrième client pour son activité de puces IA, qui s'était engagé à passer des commandes pour un montant de 10 milliards de dollars. Tan n'a pas nommé le client, mais un rapport qui cite des personnes proches du dossier a confirmé qu'il s'agissait d'OpenAI.


    Selon des rumeurs persistantes, OpenAI travaillerait depuis longtemps avec Broadcom pour développer son propre semi-conducteur personnalisé pour l'entraînement et l'inférence de l'IA, l'entreprise ayant élargi son équipe dédiée aux semi-conducteurs ces dernières années pour soutenir cet effort. En août, le géant de l'IA générative avait embauché l'ancien ingénieur logiciel TPU (Tensor Processing Unit) de Google, Safeen Huda, pour rejoindre son équipe chargée des puces, aux côtés de Richard Ho, ancien responsable du projet Cloud TPU de Google. L'entreprise compte actuellement environ 40 personnes dans son équipe chargée des puces personnalisées. En plus de collaborer avec OpenAI sur sa puce IA, Broadcom a également été fortement impliqué dans le développement de la puce IA TPU de Google.

    Actuellement, OpenAI est l'un des plus grands utilisateurs de GPU Nvidia pour les charges de travail de formation et d'inférence, mais a choisi de fabriquer ses propres puces personnalisées afin de réduire sa dépendance vis-à-vis du matériel Nvidia. Cependant, la société a précédemment cherché à diversifier ses ressources informatiques en déployant des TPU Google et des GPU AMD, et a déclaré qu'elle fournirait à Microsoft des commentaires sur son propre projet de puce IA personnalisée, baptisé Maia.

    Ce rapport intervient alors que le géant britannique de la grande distribution Tesco a intenté une action en justice contre Broadcom Inc., sa filiale VMware et le revendeur Computacenter PLC. L'entreprise reproche à ces derniers d'avoir refusé de fournir une assistance après le passage de Broadcom à un système d'abonnement, suite à son acquisition en 2023. Réclamant plus de 100 millions de livres sterling de dommages et intérêts, Tesco met en garde contre des perturbations opérationnelles de ses systèmes informatiques et de la chaîne d'approvisionnement alimentaire au Royaume-Uni. Des litiges similaires impliquant AT&T et Siemens soulignent la réaction négative du secteur à l'égard des pratiques de Broadcom.

    Et vous ?

    Pensez-vous que ce rapport est crédible ou pertinent ?
    Quel est votre avis sur le sujet ?

    Voir aussi :

    OpenAI contraint de ralentir le déploiement de GPT-4.5 : Sam Altman révèle qu'OpenAI manque de GPU. Une situation qui révèle les faiblesses structurelles de l'industrie de l'intelligence artificielle

    À la fin du deuxième trimestre 2025, Nvidia contrôle environ 94 % du segment des cartes graphiques dédiées, tandis que la part de marché d'AMD est tombée à seulement 6 % et celle d'Intel est inexistante

    Huit géants technologiques s'associent contre NVIDIA sous le nom d'Ultra Accelerator Link : ils proposent une nouvelle norme d'interconnexion, pour les puces accélératrices d'IA dans les centres de données
    Publication de communiqués de presse en informatique. Contribuez au club : corrections, suggestions, critiques, ... Contactez le service news et Rédigez des actualités

  7. #7
    Chroniqueur Actualités
    Avatar de Anthony
    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Novembre 2022
    Messages
    2 284
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Gironde (Aquitaine)

    Informations professionnelles :
    Activité : Rédacteur technique

    Informations forums :
    Inscription : Novembre 2022
    Messages : 2 284
    Par défaut OpenAI et Broadcom dévoilent « Jalapeño », la première puce d'inférence IA sur mesure d'OpenAI
    OpenAI et Broadcom dévoilent « Jalapeño », la première puce d'IA sur mesure d'OpenAI, conçue principalement pour prendre en charge l'inférence pour ChatGPT et d'autres services, et réduire les coûts de 50 %

    OpenAI et Broadcom ont dévoilé « Jalapeño », la première puce d'intelligence artificielle (IA) sur mesure d'OpenAI, conçue pour gérer les charges de travail d'inférence de ChatGPT et d'autres services d'IA. Développée en neuf mois à l’aide des modèles d’IA d’OpenAI, cette puce ASIC vise à réduire les coûts de calcul de 50 % tout en offrant une meilleure efficacité. Avec un déploiement prévu pour la fin de l'année 2026, Jalapeño marque une étape majeure dans la stratégie d'OpenAI visant à développer sa propre pile matérielle dédiée à l'IA.

    OpenAI est un organisme américain de recherche en IA dont le siège social est situé à San Francisco. Il est constitué d’OpenAI Group PBC, une société d’intérêt public à but lucratif (PBC), contrôlée en partie par OpenAI Foundation, une organisation à but non lucratif. OpenAI a développé la famille de grands modèles de langage « Generative Pre-trained Transformer » (GPT), la série DALL-E et la série Sora, qui ont influencé la recherche dans le secteur et les applications commerciales. Le lancement de ChatGPT par OpenAI en novembre 2022 est considéré comme ayant catalysé l'essor de l'IA et suscité un intérêt généralisé pour l'IA générative.

    En septembre 2025, OpenAI a confirmé son intention de lancer la production de sa propre puce d'IA personnalisée en collaboration avec Broadcom, à partir de 2026. Conçue pour un usage interne exclusif, ce projet est le fruit de plusieurs années de développement et du renforcement progressif des équipes d'OpenAI spécialisées dans les semi-conducteurs, dans le but de réduire sa dépendance aux fournisseurs externes.

    Le mercredi 24 juin 2026, OpenAI et Broadcom ont dévoilé leur première puce sur mesure, baptisée « Jalapeño », marquant ainsi les premiers pas de l'éditeur de ChatGPT dans le domaine des puces d'IA.

    Ces puces seront fabriquées par Broadcom et utilisées par OpenAI pour l'inférence, le processus très gourmand en ressources informatiques qui permet de mettre ses modèles d'IA à la disposition des utilisateurs de ChatGPT et d'autres applications.

    Le président d'OpenAI, Greg Brockman, a déclaré que les puces « Jalapeño » avaient été conçues de A à Z en neuf mois grâce aux modèles d'IA de l'entreprise. « La mesure dans laquelle nos modèles ont permis d'accélérer ce processus nous a beaucoup surpris », a déclaré Brockman.


    Broadcom figure parmi les principaux bénéficiaires de l'essor de l'IA générative, en aidant les hyperscalers et les laboratoires de pointe à concevoir leurs propres puces sur mesure pour l'IA. Depuis le début de l'année 2026, l'action du fabricant de puces a progressé de 10 % et a été multipliée par près de sept depuis la fin de l'année 2022. À la suite de cette annonce, le titre a de nouveau grimpé.

    Greg Brockman a déclaré qu’OpenAI « ne parvient pas à obtenir de la puissance de calcul assez rapidement », une affirmation que Hock Tan, PDG de Broadcom, a confirmée en déclarant que la demande en puissance de calcul des plus gros clients de l’entreprise était « tout simplement insatiable ».

    « C'est bien plus que ce que nous sommes en mesure de gérer », a déclaré Greg Brockman, « et cela ne concerne pas seulement 2026 ou 2027 : nous constatons la même demande, voire une demande encore plus forte, en 2028 également. »

    Jalapeño constitue une étape majeure dans le projet d’OpenAI visant à « développer l’ensemble de la pile technologique sous-jacente à ses modèles et produits », selon le communiqué de presse annonçant le lancement de la puce d'IA.

    « En concevant nous-mêmes une plus grande partie de cette pile, nous pouvons fournir davantage de capacités intelligentes avec une plus grande efficacité et continuer à rendre l’IA de pointe accessible à un public plus large », a déclaré Greg Brockman dans le communiqué.

    OpenAI s'associe avec Broadcom pour réduire sa dépendance vis-à-vis des GPU de Nvidia

    Depuis qu’OpenAI a déclenché le boom de l’IA générative en 2022, l’entreprise figure parmi les plus gros acheteurs des coûteux processeurs graphiques de Nvidia, élément clé de l’infrastructure nécessaire à la création de modèles d’IA et à l’exécution de charges de travail importantes. Mais OpenAI connaît une telle explosion de la demande qu’elle a besoin de s’approvisionner auprès d’autres fournisseurs de puces de pointe.

    Au début de l'année, OpenAI a conclu un accord avec Amazon Web Services prévoyant notamment l'utilisation des puces d'IA Trainium de cette dernière. OpenAI a également signé des accords avec Advanced Micro Devices, concurrent de Nvidia, ainsi qu'avec le fabricant de puces d'IA Cerebras, qui a réalisé son introduction en bourse en mai 2026.

    En octobre 2025, après 18 mois de collaboration, OpenAI et Broadcom ont annoncé leur intention de développer et de déployer des racks de puces conçues par OpenAI à partir de la fin de cette année, avec pour objectif final d'en fabriquer suffisamment pour atteindre une consommation électrique de 10 gigawatts.

    La puce développée avec Broadcom est un ASIC, que les experts du secteur jugent moins flexible que le GPU de Nvidia, mais qui est également moins coûteux et peut être conçu pour des tâches spécifiques liées à l'IA. OpenAI a indiqué avoir conçu cette puce en neuf mois, ainsi qu'une grande partie du système informatique dans lequel elle sera intégrée.

    Les deux entreprises qualifient cette puce d’« Intelligence Processor » (processeur d'intelligence) et la décrivent comme le premier « accélérateur d’IA » d’une plateforme qu’elles développent « pour rendre l’IA de pointe plus rapide, plus fiable et plus accessible à un plus grand nombre de personnes ».

    Un échantillon physique de la nouvelle puce a été remis à OpenAI le mercredi dernier. Les deux entreprises ont indiqué qu'elles prévoyaient un premier déploiement des puces « Jalapeño » d'ici fin 2026, avec une « expansion dans les années à venir ».

    Hock Tan a indiqué qu’un « développement de petits prototypes » aurait lieu fin 2026, après quoi le projet prendrait de l’ampleur. « Nous commencerons à voir le projet prendre véritablement de l’ampleur en 2027, pour passer à la vitesse supérieure au cours du premier semestre 2028 », a déclaré le PDG de Broadcom.

    Annonce du lancement de la puce « Jalapeño »

    L'annonce faite par OpenAI et Broadcom concernant la puce d'inférence « Jalapeño » est présentée ci-dessous :

    « OpenAI et Broadcom ont dévoilé aujourd’hui Jalapeño, le premier processeur d’intelligence d’OpenAI : un accélérateur conçu autour de la vision d’OpenAI pour l’avenir de l’inférence des grands modèles de langage (LLM), et le premier accélérateur d’IA intégré à une plateforme de calcul multigénérationnelle que les deux entreprises développent conjointement afin de rendre l’IA avancée plus rapide, plus fiable et plus accessible à un plus grand nombre de personnes.

    Jalapeño a été remis à Sam Altman, PDG d’OpenAI, et à Greg Brockman, président de l’entreprise, par Hock Tan, PDG de Broadcom, et Charlie Kawwas, président de la société, marquant ainsi une étape importante dans la stratégie d’OpenAI visant à développer l’ensemble de la pile technologique sous-jacente à ses modèles et produits.

    OpenAI a conçu cette puce à partir de zéro en s’appuyant sur sa connaissance approfondie des principes fondamentaux des LLM, guidée par sa feuille de route en matière de modèles, de noyaux, de systèmes de mise à disposition et de besoins produit, en collaboration avec ses partenaires Broadcom et Celestica, qui ont contribué à l’industrialisation de la plateforme via la mise en œuvre de la puce, l’intégration des cartes et des systèmes de rack, la mise en place d’un réseau haute performance et la mise en place de systèmes de production évolutifs. Jalapeño est conçu pour offrir une grande flexibilité et fonctionner avec tous les LLM, en s’appuyant sur les connaissances d’OpenAI concernant les besoins en matière d’inférence des modèles d’IA actuels et futurs dans l’ensemble du secteur. Des échantillons d’ingénierie de la puce Jalapeño exécutent actuellement des charges de travail d’apprentissage automatique en laboratoire à la fréquence et à la puissance cibles de production, incluant GPT‑5.3‑Codex‑Spark.

    Bien qu’OpenAI soit encore en train d’évaluer les performances finales, les premiers tests montrent que Jalapeño offrira un rapport performances/watt nettement supérieur à celui des solutions de pointe actuelles. Un rapport technique détaillé sur les performances sera présenté dans les prochains mois. L’architecture réduit les transferts de données et équilibre les ressources de calcul, de mémoire et de réseau afin d’atteindre un taux d’utilisation réel beaucoup plus proche des performances maximales théoriques. La mise en œuvre sur silicium et les technologies réseau de Broadcom, notamment la puce réseau Tomahawk, contribuent à la mise en production à grande échelle de la plateforme.

    Nom : openai broadcom jalapeno puce IA.png
Affichages : 567
Taille : 224,4 Ko

    « Le monde évolue vers une économie fondée sur la puissance de calcul », a déclaré Greg Brockman, président et cofondateur d’OpenAI. « Jalapeño s’inscrit dans notre stratégie à long terme d’infrastructure full-stack visant à rendre la puissance de calcul plus abondante, ce qui se traduira par une IA plus rapide, plus fiable et plus abordable pour les particuliers et les entreprises, et qui pourra être utilisée pour résoudre des problèmes plus importants. En concevant nous-mêmes une plus grande partie de la pile, nous pouvons fournir davantage de capacités d’intelligence avec une plus grande efficacité et continuer à rendre l’IA de pointe accessible à un public plus large. »

    « Jalapeño a été entièrement conçue pour l’inférence sur les grands modèles de langage (LLM), en s’appuyant sur les connaissances approfondies issues de notre étroite collaboration avec les chercheurs d’OpenAI », a déclaré Richard Ho, responsable du programme matériel chez OpenAI. « Nous avons optimisé l’architecture en nous concentrant sur les noyaux, les mouvements de mémoire, la mise en réseau et les modèles de service qui revêtent la plus grande importance pour les modèles d’IA de pointe. D’après les premiers tests, Jalapeño exécutera efficacement nos charges de travail les plus importantes, à un niveau proche des limites théoriques du matériel. »

    « Notre collaboration avec OpenAI témoigne de notre engagement fondamental à développer l’infrastructure physique nécessaire pour la prochaine décennie de l’IA », a déclaré Hock Tan, président-directeur général de Broadcom. « Ce n’est que le début d’une feuille de route s’étendant sur plusieurs générations. En développant conjointement nos puces de pointe directement avec OpenAI, nous permettons le déploiement, dès 2026, de centres de données d’une puissance de l’ordre du gigawatt avec Microsoft et d’autres partenaires. »

    Conçue pour être la meilleure plateforme d'inférence pour les LLM

    Jalapeño est une conception entièrement nouvelle destinée à l’inférence des grands modèles de langage (LLM) modernes, et non un accélérateur polyvalent adapté à partir d’anciennes charges de travail d’IA. Il s’inspire des systèmes qu’OpenAI exploite quotidiennement pour ChatGPT, Codex, l’API et ses futurs produits agentiques, tout en étant conçu pour les LLM actuels et futurs de l’ensemble du secteur. L’objectif est d’allier la puissance et le débit des principaux accélérateurs d’IA actuels à une latence plus proche de celle des systèmes d’inférence spécialisés les plus rapides, ce qui rend Jalapeño particulièrement adapté aux produits LLM interactifs à grande échelle.

    C’est là tout l’avantage d’une approche « full-stack ». OpenAI ne se contente pas de développer des modèles de pointe ou de créer des produits à partir de ceux-ci ; l’entreprise conçoit également l’infrastructure qui les sous-tend : architecture des puces, noyaux, systèmes de mémoire, réseaux, planification, systèmes de déploiement et expérience utilisateur. Comme OpenAI intervient à tous les niveaux de la pile, chaque couche peut être optimisée en fonction d’un même objectif : rendre ses modèles plus rapides, plus fiables et plus abordables pour les utilisateurs.

    Jalapeño renforce la dynamique qui sous-tend les progrès d’OpenAI. Une meilleure infrastructure améliore l’efficacité de calcul. Une meilleure efficacité de calcul permet d’optimiser l’entraînement et la mise en service, ce qui se traduit au final par des modèles d’IA plus performants. De meilleurs modèles se traduisent par de meilleurs produits pour les particuliers, les développeurs et les entreprises. De meilleurs produits génèrent une utilisation accrue, davantage de clients et un chiffre d’affaires plus élevé, ce qui permet à OpenAI de réinvestir dans la prochaine génération d’infrastructures. Au fil du temps, ce cycle contribue à rendre l’intelligence plus performante, plus fiable et moins coûteuse pour tous.

    Une mise en production en neuf mois, accélérée par les modèles d'OpenAI

    Le Jalapeño a été développé conjointement, de la conception initiale jusqu’à la validation de la conception (tape-out), en seulement neuf mois, et ce programme d’accélérateur d’IA sur mesure représente, selon nous, le cycle de développement d’ASIC le plus rapide jamais réalisé dans le domaine des semi-conducteurs avancés à haute performance. Cette rapidité est le fruit d’un co-développement logiciel-matériel approfondi avec les équipes d’ingénierie d’OpenAI, de l’expertise de Broadcom en matière de mise en œuvre sur silicium, ainsi que de l’utilisation des modèles d’OpenAI pour accélérer certaines étapes du processus de conception et d’optimisation.

    Les modèles mis à la disposition des utilisateurs contribuent à améliorer l'infrastructure nécessaire au fonctionnement des futurs modèles. Si l'IA peut aider les ingénieurs à concevoir plus rapidement de meilleures puces, elle permettra de réduire le coût du calcul à l'échelle du secteur et contribuera à démocratiser l'accès à l'IA de pointe.

    Mettre en place une plateforme multigénérationnelle avec des partenaires

    Jalapeño constitue la première étape d’une plateforme informatique multigénérationnelle conçue pour un déploiement initial d’ici fin 2026, puis pour une expansion dans les années à venir. Elle associe des accélérateurs conçus par OpenAI à des puces Broadcom ainsi qu’à des technologies de mise en réseau et de connectivité, tout en s’appuyant sur l’expertise de Celestica en matière de cartes électroniques, de racks et de systèmes.

    Rendre l'IA de pointe plus largement accessible

    Le principe de ce travail est simple : c’est par l’inférence que l’IA touche le grand public. Chaque amélioration en termes de coût, de rapidité et de fiabilité peut se traduire par une réponse plus rapide de ChatGPT, une tâche Codex pouvant effectuer davantage d’étapes avec moins de temps d’attente, un produit API moins coûteux à développer ou un accès plus fiable lorsque la demande est forte.

    Démocratiser l'IA, c'est rendre les modèles avancés accessibles, fiables et suffisamment abordables pour qu'un plus grand nombre de personnes puissent les utiliser au quotidien. Jalapeño aide OpenAI à transformer une plus grande partie de son infrastructure en intelligence utile pour les étudiants, les développeurs, les petites entreprises, les chercheurs, les grandes entreprises et tous ceux qui cherchent à apprendre, à créer ou à résoudre des problèmes complexes.

    »

    Cette annonce intervient alors qu'OpenAI est confrontée à des tensions financières importantes. Des documents financiers récemment divulgués indiquent en effet que l'entreprise perd plusieurs milliards de dollars par an, principalement en raison des coûts élevés de la R&D et de l'infrastructure. Malgré une croissance significative de son chiffre d'affaires, ces dépenses continuent de dépasser largement les revenus, alimentant un déficit opérationnel croissant.

    Sources : OpenAI, Broadcom

    Et vous ?

    Quel est votre avis sur le sujet ?
    Trouvez-vous cette initiative d'OpenAI crédible ou pertinente ?

    Voir aussi :

    OpenAI signe un accord pluriannuel avec AMD pour l'achat de puces IA d'une valeur de plusieurs dizaines de milliards $, incluant jusqu'à 6 GW de GPU Instinct dès 2026 et une option de participation dans AMD

    OpenAI s'associe avec TSMC pour développer ses propres puces d'IA, conçues avec Broadcom, qui se concentreront dans un premier temps sur l'exécution de modèles d'IA plutôt que sur leur entraînement

    OpenAI signe un accord surprise avec Google Cloud malgré une rivalité féroce entre les deux entreprises dans la course à l'IA, l'accord illustre l'éloignement progressif entre OpenAI et Microsoft
    Contribuez au club : corrections, suggestions, critiques, ... Contactez le service news et Rédigez des actualités

Discussions similaires

  1. Réponses: 1
    Dernier message: 21/01/2026, 14h08
  2. Réponses: 0
    Dernier message: 01/09/2025, 14h03
  3. Réponses: 0
    Dernier message: 16/11/2023, 08h01
  4. Envoi Mail avec puce M1 et Big Sur
    Par guyfroment dans le forum AppleScript
    Réponses: 2
    Dernier message: 17/01/2021, 11h50
  5. insertion de puce ("bullets") via vba sur powerpoint 2007
    Par ola-oz dans le forum VBA PowerPoint
    Réponses: 6
    Dernier message: 08/06/2010, 16h26

Partager

Partager
  • Envoyer la discussion sur Viadeo
  • Envoyer la discussion sur Twitter
  • Envoyer la discussion sur Google
  • Envoyer la discussion sur Facebook
  • Envoyer la discussion sur Digg
  • Envoyer la discussion sur Delicious
  • Envoyer la discussion sur MySpace
  • Envoyer la discussion sur Yahoo