IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)
Navigation

Inscrivez-vous gratuitement
pour pouvoir participer, suivre les réponses en temps réel, voter pour les messages, poser vos propres questions et recevoir la newsletter

Intelligence artificielle Discussion :

L'administration Trump demande à OpenAI de retarder la sortie de son nouveau modèle GPT-5.6


Sujet :

Intelligence artificielle

  1. #1
    Communiqués de presse

    Femme Profil pro
    Traductrice Technique
    Inscrit en
    Juin 2023
    Messages
    2 993
    Détails du profil
    Informations personnelles :
    Sexe : Femme
    Localisation : France

    Informations professionnelles :
    Activité : Traductrice Technique

    Informations forums :
    Inscription : Juin 2023
    Messages : 2 993
    Par défaut L'administration Trump demande à OpenAI de retarder la sortie de son nouveau modèle GPT-5.6
    L'administration Trump demande à OpenAI de retarder la sortie de son nouveau modèle GPT-5.6 en raison des inquiétudes concernant l'IA avancée, après qu'Anthropic a suspendu l'accès mondial à Mythos 5 et Fable 5

    L'administration Trump a demandé à OpenAI de publier son prochain modèle, GPT-5.6, sous forme d’aperçu limité plutôt que de procéder à un lancement public à grande échelle, le gouvernement approuvant l’accès « client par client pendant cette période d’aperçu », selon The Information. Concrètement, cela signifie que le rythme des lancements commerciaux d’OpenAI dépend, au moins en partie, du calendrier de Washington. Plutôt que d’être déployé simultanément, l’accès au GPT-5.6 sera limité à un petit groupe de partenaires pendant que le gouvernement procède à son examen. Ce rapport intervient alors que l'administration Trump a interrompu le déploiement de Mythos 5 et Fable 5 d'Anthropic en invoquant des impératifs de sécurité nationale.

    OpenAI est un organisme américain de recherche en intelligence artificielle (IA) dont le siège social est situé à San Francisco. Il est constitué d’OpenAI Group PBC, une société d’intérêt public à but lucratif (PBC), contrôlée en partie par OpenAI Foundation, une organisation à but non lucratif. OpenAI a développé la famille de grands modèles de langage « Generative Pre-trained Transformer » (GPT), la série DALL-E de modèles de conversion texte-image et la série Sora de modèles de conversion texte-vidéo, qui ont influencé la recherche dans le secteur et les applications commerciales. Le lancement de ChatGPT en novembre 2022 est considéré comme ayant catalysé l’essor de l’IA et suscité un intérêt généralisé pour l’IA générative.

    Récemment, l’administration Trump a demandé à OpenAI de publier son prochain modèle, GPT-5.6, sous forme d’aperçu limité plutôt que de procéder à un lancement public à grande échelle, le gouvernement approuvant l’accès « client par client pendant cette période d’aperçu », selon The Information. Le PDG d’OpenAI, Sam Altman, a fait part de cet accord à son personnel lors d’une session interne de questions-réponses. Cette demande serait issue de discussions avec deux services gouvernementaux : le Bureau du directeur national de la cybersécurité et le Bureau de la politique scientifique et technologique.

    Concrètement, cela signifie que le rythme des lancements commerciaux d’OpenAI dépend, au moins en partie, du calendrier de Washington. Plutôt que d’être déployé simultanément, l’accès au GPT-5.6 sera limité à un petit groupe de partenaires pendant que le gouvernement procède à son examen. The Information a obtenu ces détails grâce à une note interne de l’entreprise.

    Ce que l’article ne précise pas, ce sont les critères de sécurité spécifiques que le gouvernement applique pour évaluer l’éligibilité des clients, ni si cet accord s’étend aux futures versions du modèle au-delà de GPT-5.6. Cette sélection client par client soulève également une question évidente pour les clients internationaux d’OpenAI : l’autorisation du gouvernement américain s’applique-t-elle également à eux ?

    Tel qu’il est décrit, cet accord semble relever d’une coopération plutôt que d’une obligation légale. Les entreprises ayant déjà établi des relations avec le gouvernement sont mieux placées pour passer plus rapidement par tout processus d’approbation que celles qui n’en ont pas. La volonté d’OpenAI de coordonner l’ordre de lancement renforce sa position pour les contrats gouvernementaux et tout cadre de déploiement officiel qui pourrait s’ensuivre.

    Ce rapport intervient alors que l'administration Trump a interrompu le déploiement de Mythos 5 et Fable 5 d'Anthropic en invoquant des impératifs de sécurité nationale. Cette décision repose sur des craintes de cyberattaques potentielles et de contournement des garde-fous techniques par des acteurs étrangers. Bien qu'Anthropic conteste la gravité de ces failles, la Maison Blanche a imposé des contrôles à l'exportation inédits qui interdisent l'accès aux modèles même pour les employés étrangers de l'entreprise. Anthropic cherche à lever l'interdiction, tandis que les experts s'inquiètent de l'impact de cette décision sur la compétitivité des États-Unis face à la concurrence mondiale.

    Source : The Information

    Et vous ?

    Pensez-vous que ce rapport est crédible ou pertinent ?
    Quel est votre avis sur le sujet ?

    Voir aussi :

    OpenAI lance la plateforme de cybersécurité Daybreak pour concurrencer Anthropic, en utilisant ses modèles GPT-5.5 et l'agent Codex Security pour détecter et corriger les failles logicielles avant les attaques

    Le modèle d'IA « Mythos » d'Anthropic a découvert des failles dans certains des systèmes informatiques les plus sensibles du gouvernement US lors d'un exercice de test, a confirmé un responsable américain

    Les USA doivent adopter un vaste système de surveillance basé sur l'IA pour dominer la course mondiale à l'IA, plutôt que de risquer de se faire distancer par la Chine, selon le PDG de Palantir, Alex Karp
    Publication de communiqués de presse en informatique. Contribuez au club : corrections, suggestions, critiques, ... Contactez le service news et Rédigez des actualités

  2. #2
    Invité de passage
    Homme Profil pro
    grand utilisateur de linux
    Inscrit en
    Mars 2026
    Messages
    36
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : Autre

    Informations professionnelles :
    Activité : grand utilisateur de linux

    Informations forums :
    Inscription : Mars 2026
    Messages : 36
    Par défaut
    Le gouvernement américain va sans doute pouvoir limiter les sorties des modèles d'IA privés américains, mais comme dit dans la news qu'en est-il de la Chine ? Des modèles open source qui rattraperont tôt ou tard le niveau ?

    Ils vont freiner le développement des États-Unis au profit de la Chine qui n'a que 4 mois de retard sur Anthropic et Open AI. L'open source je ne sais pas. Mais ils doivent avoir quelque chose comme 6 mois de retard. Ce n'est que partie remise à plus tard pour que la défense surpasse l'attaque en cyber.

    En effet, en utilisant l'IA à bon escient les failles seront connues des 2 côtés. Reste à patcher plus vite que l'attaquant développera son offensive. Tout automatiser pourrait donner la suprématie (enfin) à la défense.

  3. #3
    Communiqués de presse

    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Avril 2025
    Messages
    819
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Paris (Île de France)

    Informations professionnelles :
    Activité : Rédacteur technique

    Informations forums :
    Inscription : Avril 2025
    Messages : 819
    Par défaut OpenAI a lancé une préversion limitée de sa série GPT-5.6, présentant trois nouveaux modèles
    OpenAI a lancé une préversion limitée de sa série GPT-5.6, présentant trois nouveaux modèles d'IA : Sol, Terra et Luna, ainsi que des mesures de sécurité informatique renforcées

    OpenAI a lancé une préversion limitée de sa série GPT-5.6, présentant trois nouveaux modèles : Sol, Terra et Luna. Sol est présenté comme le modèle phare, Terra est conçu pour un usage quotidien avec des fonctionnalités équilibrées, et Luna offre un accès rapide et abordable. Bien que cette gamme soit nouvelle, Sol se distingue par les fonctionnalités de sécurité les plus avancées à ce jour. Ces modèles partagent des mesures de sécurité mises à jour et adaptées aux capacités de chacun. GPT-5.6 refuse activement toute cyber-assistance interdite, y compris les tentatives de contournement, et utilise des classificateurs d’utilisation abusive en temps réel.

    OpenAI est un organisme américain de recherche en intelligence artificielle (IA) dont le siège social est situé à San Francisco. Il est constitué d’OpenAI Group PBC, une société d’intérêt public à but lucratif (PBC), contrôlée en partie par OpenAI Foundation, une organisation à but non lucratif. OpenAI a développé la famille de grands modèles de langage « Generative Pre-trained Transformer » (GPT), la série DALL-E de modèles de conversion texte-image et la série Sora de modèles de conversion texte-vidéo, qui ont influencé la recherche dans le secteur et les applications commerciales. Le lancement de ChatGPT en novembre 2022 est considéré comme ayant catalysé l’essor de l’IA et suscité un intérêt généralisé pour l’IA générative.

    Fin juin 2026, l’administration Trump a demandé à OpenAI de publier son prochain modèle, GPT-5.6, sous forme d’aperçu limité plutôt que de procéder à un lancement public à grande échelle, le gouvernement approuvant l’accès « client par client pendant cette période d’aperçu ». Concrètement, cela signifie que le rythme des lancements commerciaux d’OpenAI dépend, au moins en partie, du calendrier de Washington. Plutôt que d’être déployé simultanément, l’accès au GPT-5.6 sera limité à un petit groupe de partenaires pendant que le gouvernement procède à son examen. Ce rapport intervient alors que l'administration Trump a interrompu le déploiement de Mythos 5 et Fable 5 d'Anthropic en invoquant des impératifs de sécurité nationale.

    Récemment, OpenAI a lancé une préversion limitée de sa série GPT-5.6, présentant trois nouveaux modèles : Sol, Terra et Luna. Sol est présenté comme le modèle phare, Terra est conçu pour un usage quotidien avec des fonctionnalités équilibrées, et Luna offre un accès rapide et abordable. Bien que cette gamme soit nouvelle, Sol se distingue par les fonctionnalités de sécurité les plus avancées à ce jour. Les protections ont été renforcées pour les activités sensibles et à haut risque, y compris les abus répétés, et des évaluations de préparation supplémentaires sont mises à la disposition des partenaires.

    S’appuyant sur ces efforts en matière de sécurité, Sol est également le modèle d’OpenAI le plus performant en matière de cybersécurité. Il repousse les limites de la performance et de l’efficacité pour des tâches de sécurité exigeantes telles que la recherche et l’exploitation de vulnérabilités. Sol intègre également de nouvelles avancées techniques : un « mode ultra » qui exploite des sous-agents pour les tâches complexes et un « effort de raisonnement maximal » permettant une résolution plus approfondie des problèmes. Terra offre des performances proches de celles de GPT-5.5 pour la moitié du prix, tandis que Luna apporte de solides capacités au prix le plus bas proposé par OpenAI.

    Ces modèles partagent des mesures de sécurité mises à jour et adaptées aux capacités de chacun. GPT-5.6 refuse activement toute cyber-assistance interdite, y compris les tentatives de contournement, et utilise des classificateurs d’utilisation abusive en temps réel. Pour les cas à haut risque, les résultats peuvent être transmis à un modèle plus puissant pour examen et retenus s’ils sont jugés non conformes. L’accès initial à la préversion est limité à certains partenaires via l’API et Codex, un déploiement plus large étant prévu prochainement.

    Début janvier 2026, les documents internes d'OpenAI ont révélé une perte de 14 milliards de $ en 2026. À mesure que l’intelligence artificielle générative s’impose comme un pilier stratégique pour les grandes entreprises technologiques, la réalité économique qui la sous-tend apparaît de plus en plus contrastée. Derrière l’image d’une OpenAI toute-puissante, portée par le succès planétaire de ChatGPT, se dessine un modèle financier sous tension, marqué par des pertes colossales anticipées et une dépendance accrue à des partenariats géopolitiques et industriels. Entre projections internes alarmantes et tournées diplomatiques de son dirigeant, l’entreprise incarne aujourd’hui les paradoxes d’une IA devenue incontournable, mais encore loin d’être rentable.

    Nom : 1.jpg
Affichages : 716
Taille : 58,8 Ko

    Voici l'annonce d'OpenAI :

    Aperçu de GPT‑5.6 Sol : un modèle de nouvelle génération

    Nous lançons un aperçu limité de la série GPT‑5.6 : Sol, notre modèle phare ; Terra, un modèle équilibré pour le travail quotidien ; et Luna, un modèle rapide et abordable. Terra offre des performances compétitives par rapport à GPT‑5.5 tout en coûtant deux fois moins cher, et Luna apporte de solides capacités à notre coût le plus bas.

    GPT‑5.6 Sol est lancé avec notre pile de sécurité la plus robuste à ce jour. Nous avons renforcé les protections pour les activités à risque plus élevé, les demandes cyber sensibles et les abus répétés, et consacré plusieurs semaines à trouver les faiblesses, à soumettre notre système à des tests de résistance et à le durcir contre les attaques réelles.

    Nous croyons à un accès large, et nous prévoyons de rendre GPT‑5.6 Sol, Terra et Luna généralement disponibles dans les prochaines semaines. Dans le cadre de notre dialogue continu avec le gouvernement des États-Unis, nous avons présenté en amont nos plans et les capacités des modèles avant le lancement d’aujourd’hui. À sa demande, nous commençons par un aperçu limité auprès d’un petit groupe de partenaires de confiance dont la participation a été communiquée au gouvernement, avant une diffusion plus large. Pendant cet aperçu, nous continuerons à tester et à nous coordonner étroitement avec nos partenaires alors que nous progressons vers une disponibilité plus large. Nous ne pensons pas que ce type de processus d’accès gouvernemental doive devenir la norme à long terme. Il prive des meilleurs outils les utilisateurs, développeurs, entreprises, défenseurs cyber et partenaires internationaux qui en ont besoin. Nous prenons cette mesure à court terme parce que nous pensons que c’est la meilleure voie vers une disponibilité plus large dans les prochaines semaines, tout en travaillant avec l’Administration à l’élaboration du cadre prévu par l’Executive Order cyber et d’un processus reproductible pour les futures sorties de modèles.

    Capacités

    GPT‑5.6 Sol est notre modèle le plus puissant à ce jour. Pour donner un aperçu des performances du modèle, nous partageons un ensemble d’évaluations mettant en évidence de meilleures capacités agentiques en codage, biologie et cybersécurité, avec des évaluations supplémentaires de sécurité et de préparation disponibles dans notre fiche système⁠. Nous partagerons un ensemble élargi de résultats d’évaluation lorsque nous rendrons le modèle largement disponible.

    Avec GPT‑5.6, nous introduisons un nouvel effort de raisonnement `max` afin de donner à Sol le plus de temps possible pour raisonner en profondeur. Nous introduisons également un nouveau mode `ultra` qui dépasse les capacités d’un agent unique en s’appuyant sur des sous-agents pour accélérer les travaux complexes.

    Pour les workflows de codage, GPT‑5.6 Sol établit un nouvel état de l’art sur Terminal‑Bench 2.1, qui teste des workflows en ligne de commande nécessitant planification, itération et coordination d’outils

    Nom : 2.jpg
Affichages : 629
Taille : 35,9 Ko

    GPT‑5.6 Sol montre également de larges progrès dans les workflows de biologie. Sur GeneBench v1, qui évalue des analyses génomiques et de biologie quantitative à long horizon, il obtient de meilleurs résultats que GPT‑5.5 tout en utilisant moins de tokens.

    Nom : 3.jpg
Affichages : 627
Taille : 31,8 Ko

    GPT‑5.6 Sol est notre modèle le plus performant à ce jour pour la cybersécurité. Il déplace la frontière performance-efficacité pour les tâches de sécurité à long horizon, notamment la recherche de vulnérabilités et l’exploitation. Sur ExploitBench, GPT‑5.6 Sol est compétitif avec Mythos Preview en n’utilisant qu’environ un tiers des tokens de sortie. Sur ExploitGym⁠, un benchmark créé par des chercheurs de l’UC Berkeley en collaboration avec OpenAI et d’autres laboratoires frontière, les modèles GPT‑5.6 Sol, Terra et Luna démontrent tous de solides progrès en capacités cyber à mesure que nous augmentons le raisonnement.

    Nom : 4.jpg
Affichages : 623
Taille : 40,0 Ko
    Nom : 5.jpg
Affichages : 624
Taille : 33,5 Ko

    Des capacités cyber plus fortes avec des protections plus solides

    Nous avons développé GPT‑5.6 Sol, Terra et Luna avec nos protections les plus robustes à ce jour, selon des configurations adaptées aux capacités de chaque modèle. À mesure que le modèle devient plus capable, nous concevons des protections qui résistent de mieux en mieux à la pression adversariale du monde réel, tout en préservant l’accès aux travaux légitimes comme la revue de code, la recherche de vulnérabilités, le développement de correctifs, le débogage, la formation à la sécurité et les tests défensifs. Notre objectif est de rendre les activités offensives interdites plus difficiles, incertaines et détectables, sans limiter inutilement ces usages bénéfiques. D’après notre évaluation du modèle et des protections, nous anticipons des bénéfices substantiels pour le travail défensif légitime, tout en limitant de manière significative les usages offensifs interdits.

    GPT‑5.6 Sol aide mieux les personnes à trouver et corriger des vulnérabilités qu’à mener de manière fiable des attaques de bout en bout. À mesure que ces capacités continuent de progresser, notre priorité est de veiller à ce qu’elles parviennent aux défenseurs et leur bénéficient, afin qu’ils puissent utiliser ces outils pour trouver des faiblesses, développer des correctifs et renforcer les systèmes plus largement.

    GPT‑5.6 Sol ne franchit pas le seuil Cyber Critical défini par notre cadre de préparation⁠. Dans des évaluations impliquant Chromium et Firefox, il a identifié des bugs et des primitives d’exploitation — les briques de base d’un exploit — mais n’a pas produit de manière autonome un exploit fonctionnel en chaîne complète dans les conditions testées. Pour autant, les seuils des benchmarks ne peuvent pas couvrir toutes les façons dont un modèle peut être utilisé ou combiné avec d’autres outils. Cette incertitude, ainsi que le bond plus large des capacités du modèle, explique pourquoi nous associons ses capacités accrues à des protections renforcées et à un déploiement progressif. Nous partageons davantage de détails sur nos protections dans la fiche système de l’aperçu GPT‑5.6⁠.

    Une pile de protections en couches

    Aucune protection isolée ne suffit face à un usage abusif déterminé ou adaptatif. Dans l’aperçu GPT‑5.6, nous utilisons des protections en couches, avec des configurations exactes qui varient selon les modèles, et nous les soumettons à des tests de résistance face à des attaques réelles. Elles incluent des protections intégrées par entraînement au modèle, des vérifications en temps réel pendant la génération, des signaux au niveau du compte, un accès différencié, la surveillance, l’application des règles et des tests continus.

    GPT‑5.6 est entraîné à refuser l’assistance cyber interdite, y compris lorsque les utilisateurs tentent de dissimuler leur intention ou de jailbreaker le modèle. Ces protections au niveau du modèle établissent une première limite autour de ce que le modèle doit ou ne doit pas aider à faire.

    Les classificateurs en temps réel d’usages abusifs cyber et biologiques ajoutent une autre couche en évaluant la sortie pendant sa génération. Dans les cas à risque plus élevé, s’ils détectent une violation potentielle, la génération peut être mise en pause pendant qu’un modèle de raisonnement plus grand examine la conversation et son contexte. Si la sortie est jugée non autorisée, elle est retenue avant d’atteindre l’utilisateur.

    Une activité signalée peut aussi déclencher un examen au niveau du compte sur les conversations et signaux de risque pertinents, conformément à nos conditions et politiques relatives à la conservation et à l’examen des contenus. Regarder au-delà d’une seule conversation aide nos systèmes à distinguer un comportement malveillant persistant d’un travail de sécurité légitime à double usage, où des concepts techniques similaires peuvent apparaître dans des contextes très différents.

    Ensemble, ces couches rendent l’approche globale plus robuste que n’importe quelle protection prise isolément. Le comportement du modèle réduit la probabilité de réponses nuisibles, les systèmes en temps réel peuvent intervenir pendant la génération, l’examen au niveau du compte peut identifier des schémas plus larges, et l’accès différencié préserve les travaux défensifs importants sans rendre les capacités les plus sensibles largement disponibles par défaut.

    En particulier pendant l’aperçu, les utilisateurs peuvent rencontrer des protections qui bloquent ou refusent certaines demandes. D’autres demandes peuvent prendre plus de temps parce que la génération est suspendue pour un examen supplémentaire. Les protections peuvent parfois intervenir sur un travail légitime, en particulier dans les domaines à double usage où les activités défensives et offensives peuvent d’abord se ressembler.

    C’est l’un des points que l’aperçu est conçu pour tester. Nous voulons comprendre non seulement si les protections limitent les usages abusifs, mais aussi si les utilisateurs légitimes peuvent continuer à accomplir leur travail normal de façon fiable et efficace. Les retours pendant l’aperçu nous aideront à réduire les blocages et retards inutiles, à améliorer la manière dont les protections interprètent le contexte et à créer une expérience plus fluide avant une diffusion plus large.

    Nous travaillons également avec des clients entreprises sur des approches à plus long terme — notamment la détection préservant la confidentialité, des contrôles de sécurité opérés par le client et un accès calibré selon le risque d’un client, d’un utilisateur ou d’une charge de travail — afin de faire progresser la sécurité tout en respectant les exigences de confidentialité des entreprises.

    Améliorer la robustesse grâce au red teaming automatisé

    Les protections doivent aussi rester efficaces lorsque les attaquants adaptent leurs tactiques. Une protection qui ne fonctionne que sur un ensemble fixe d’attaques connues n’est pas assez robuste pour un modèle frontière.

    C’est pourquoi nous consacrons à la sécurité plus d’intelligence et de calcul que jamais, en utilisant nos propres modèles pour trouver les faiblesses et améliorer les protections plus rapidement. Nous avons consacré plus de 700 000 heures GPU équivalent A100 au red teaming automatisé visant à trouver des jailbreaks universels : des attaques capables de fonctionner sur de nombreux prompts ou contextes, et pas seulement dans un cadre étroit. En nous concentrant sur ces attaques plus difficiles et plus générales, nous avons pu tester les protections au-delà d’un ensemble fixe de défaillances connues. Cela nous permet aussi d’explorer bien plus de schémas d’attaque que les seuls tests humains ne pourraient couvrir, d’identifier plus tôt les types de défaillances et de réduire le délai entre la découverte d’une faiblesse et sa correction.

    Outre le red teaming automatisé, nous avons travaillé avec des testeurs tiers pour mener un vaste red teaming humain par des experts, qui se poursuivra pendant la période d’aperçu. Le red teaming humain complète le travail automatisé en testant les protections face à des experts créatifs qui tentent de détourner le modèle d’une manière que nos systèmes pourraient ne pas anticiper.

    Aucune évaluation ne peut représenter toutes les configurations produit, les attaques en plusieurs étapes ni les workflows réels. Nous maintenons donc un processus de réponse rapide pour reproduire, évaluer, hiérarchiser et corriger les jailbreaks nouvellement découverts, puis les intégrer à nos évaluations continues afin de tester à l’avenir des défaillances similaires.

    Disponibilité et tarification

    Pendant l’aperçu, les modèles GPT‑5.6 seront d’abord disponibles via l’API et Codex pour un groupe restreint de partenaires et d’organisations de confiance. Nous prévoyons de les rendre bientôt plus largement disponibles aux personnes utilisant ChatGPT, Codex et l’API.

    Dans ce nouveau système de nommage introduit avec GPT‑5.6, le nombre identifie la génération d’un modèle, tandis que Sol, Terra et Luna désignent des niveaux de capacités durables pouvant progresser à leur propre rythme. Ensemble, cette famille offre aux utilisateurs et aux développeurs des choix plus clairs en matière d’intelligence, de vitesse et de coût.

    GPT‑5.6 est facturé par million de tokens selon trois tailles de modèles : Sol à 5 $ en entrée / 30 $ en sortie ; Terra à 2,50 $ en entrée / 15 $ en sortie ; et Luna à 1 $ en entrée / 6 $ en sortie. GPT‑5.6 introduit aussi une mise en cache des prompts plus prévisible, avec notamment la prise en charge de points de rupture explicites du cache et une durée de vie minimale du cache de 30 minutes. Pour GPT‑5.6 et les modèles ultérieurs, les écritures dans le cache sont facturées 1,25 fois le tarif d’entrée non mise en cache du modèle, tandis que les lectures depuis le cache continuent de bénéficier de la remise de 90 % sur les entrées mises en cache.

    Nous lançons également GPT‑5.6 Sol sur Cerebras en juillet, jusqu’à 750 tokens par seconde, afin d’apporter une intelligence de pointe aux clients à une vitesse sans précédent. L’accès sera d’abord limité à certains clients pendant que nous augmenterons la capacité.

    Nous sommes impatients de continuer à apprendre de cette période d’aperçu et de proposer bientôt GPT‑5.6 Sol, Terra et Luna à davantage de personnes.

    Source : Annonce d'OpenAI

    Et vous ?

    Pensez-vous que cette annonce est crédible ou pertinente ?
    Quel est votre avis sur le sujet ?

    Voir aussi :

    OpenAI étend Daybreak avec Codex Security et GPT-5.5-Cyber, qui surpasse Mythos 5 d'Anthropic grâce à une automatisation complète de la détection des vulnérabilités et de l'application des correctifs

    Anthropic lance Claude Sonnet 5, une solution plus économique pour faire fonctionner des agents IA : « Il est capable d'élaborer des plans, d'utiliser des outils tels que des navigateurs et des terminaux »

    Le nouveau modèle GLM-5.2 de Z.ai devient la référence sur le marché des IA open source. Il surpasse GPT-5.5 d'OpenAI sur plusieurs benchmarks de codage à long terme, pour un coût six fois moindre
    Publication de communiqués de presse en informatique. Contribuez au club : corrections, suggestions, critiques, ... Contactez le service news et Rédigez des actualités

  4. #4
    Communiqués de presse

    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Avril 2025
    Messages
    819
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Paris (Île de France)

    Informations professionnelles :
    Activité : Rédacteur technique

    Informations forums :
    Inscription : Avril 2025
    Messages : 819
    Par défaut OpenAI a rendu GPT-5.6 accessible au grand public après que l'administration Trump eut approuvé sa diffusion
    OpenAI a rendu GPT-5.6 accessible au grand public après que l'administration Trump eut approuvé sa diffusion à grande échelle, ce modèle offre « une efficacité en termes de tokens améliorée de 54 % »

    OpenAI a commencé à déployer GPT-5.6 Sol auprès du grand public, après que l’administration Trump eut approuvé une mise à disposition à grande échelle, mettant fin à plusieurs semaines d’accès restreint à un petit groupe de partenaires agréés par le gouvernement. Le PDG d'OpenAI, Sam Altman, a déclaré que Sol atteignait une efficacité en termes de tokens supérieure de 54 % pour les tâches de codage agentique, ce qui le place au même niveau, voire devant, les modèles concurrents. Le déploiement du GPT-5.6 avait été limité à une vingtaine de partenaires après que l’administration Trump eut demandé à OpenAI de retarder la mise à disposition pendant que les agences fédérales évaluaient le modèle.

    GPT-5.6 (Generative Pre-trained Transformer 5.6) est un grand modèle de langage (LLM) développé par OpenAI. Fin juin 2026, l'administration Trump a demandé à OpenAI de publier son prochain modèle, GPT-5.6, sous forme d’aperçu limité plutôt que de procéder à un lancement public à grande échelle, le gouvernement approuvant l’accès « client par client pendant cette période d’aperçu ». Concrètement, cela signifie que le rythme des lancements commerciaux d’OpenAI dépend, au moins en partie, du calendrier de Washington. Plutôt que d’être déployé simultanément, l’accès au GPT-5.6 sera limité à un petit groupe de partenaires pendant que le gouvernement procède à son examen. Ce rapport intervient alors que l'administration Trump a interrompu le déploiement de Mythos 5 et Fable 5 d'Anthropic en invoquant des impératifs de sécurité nationale.

    C'est pourquoi OpenAI a lancé une préversion limitée de sa série GPT-5.6, présentant trois nouveaux modèles : Sol, Terra et Luna. Sol est présenté comme le modèle phare, Terra est conçu pour un usage quotidien avec des fonctionnalités équilibrées, et Luna offre un accès rapide et abordable. Bien que cette gamme soit nouvelle, Sol se distingue par les fonctionnalités de sécurité les plus avancées à ce jour. Ces modèles partagent des mesures de sécurité mises à jour et adaptées aux capacités de chacun. Selon de premières évaluations, Sol (88,8 %) et Sol Ultra (91,9 %) ont surpassé Claude Mythos 5 (88,0 %) sur TerminalBench 2.1, tandis que Luna (82,5 %) a surpassé Claude Opus 4.8 (78,9 %), bien qu’elle soit restée en deçà de GPT-5.5 (83,4 %), et Terra (84,3 %) a surpassé son propre prédécesseur. Terra est compétitif face à GPT-5.5 tout en coûtant deux fois moins cher.

    Récemment, OpenAI a commencé à déployer GPT-5.6 Sol auprès du grand public, après que l’administration Trump eut approuvé une mise à disposition à grande échelle, mettant fin à plusieurs semaines d’accès restreint à un petit groupe de partenaires agréés par le gouvernement. Le PDG d'OpenAI, Sam Altman, a déclaré que Sol atteignait une efficacité en termes de tokens supérieure de 54 % pour les tâches de codage agentique, ce qui le place au même niveau, voire devant, les modèles concurrents. « Toutes les entreprises réfléchissent désormais à leurs dépenses et à la valeur qu'elles obtiennent en échange de l'IA, et c'est exactement ce que nous voulons faire », a déclaré Altman.

    Altman a précisé que le processus d’approbation avait impliqué le secrétaire au Commerce Howard Lutnick, le secrétaire au Trésor Scott Bessent et le directeur national de la cybersécurité des États-Unis, Sean Cairncross. Il a qualifié cette dynamique de « dialogue collaboratif » au cours duquel les évaluateurs fédéraux ont soulevé des préoccupations qu’OpenAI devait résoudre. « Si vous souhaitez un large accès, ce qui est notre cas, et que vous disposez de modèles puissants, vous devez vraiment pouvoir garantir la fiabilité de vos affirmations en matière de sécurité, car sinon, le monde va très vite se sentir mal à l’aise », a-t-il déclaré.


    Le déploiement du GPT-5.6 avait été limité à une vingtaine de partenaires après que l’administration Trump eut demandé à OpenAI d’échelonner la mise à disposition pendant que les agences fédérales évaluaient le modèle. Le Centre pour les normes et l’innovation en matière d’IA du ministère du Commerce a mené cette évaluation, et OpenAI a dépêché du personnel technique à Washington pour répondre aux questions de l’agence, selon des informations précédentes. Les capacités de Sol en matière de programmation, de biologie et de cybersécurité figuraient parmi les facteurs ayant attiré l’attention des autorités fédérales.

    Ce déploiement restreint est allé au-delà du cadre d’examen volontaire préalable à la mise sur le marché signé par le président Trump le 2 juin, qui appelait les entreprises à permettre aux agences de vérifier les systèmes d’IA puissants avant leur lancement. Alors que ce cadre reposait sur une participation volontaire, la situation concernant le GPT-5.6 a abouti à une liste d’accès établie par le gouvernement — un dispositif qu’Altman a déclaré à ses employés qu’OpenAI ne considérait pas comme une approche viable à long terme.

    Cette situation a suscité des comparaisons avec l’expérience récente d’Anthropic, où un arrêté de contrôle des exportations du ministère du Commerce avait contraint l’entreprise à retirer de la vente au grand public ses modèles Fable 5 et Mythos 5. Fable 5 a depuis été remis sur le marché, mais Mythos 5 reste réservé à un cercle restreint d’organisations américaines, selon des informations précédentes. Altman a confirmé que les discussions avec l’administration Trump concernant une éventuelle prise de participation du gouvernement se poursuivaient.

    Voici un extrait de l'annonce d'OpenAI :

    GPT-5.6 : une intelligence de pointe qui s'adapte à vos ambitions

    Après une phase de préversion limitée, nous lançons la gamme de modèles GPT-5.6 en disponibilité générale : notre nouveau modèle phare, Sol, aux côtés de Terra, un modèle équilibré pour le travail quotidien, et de Luna, notre modèle le plus économique.

    GPT-5.6 Sol établit une nouvelle référence en matière d’intelligence et d’efficacité, en obtenant des résultats de pointe dans les domaines du codage, du travail intellectuel, de la cybersécurité et des sciences, tout en surpassant les modèles de pointe précédents et concurrents avec moins de tokens et à un coût estimé inférieur. Il en résulte un meilleur rapport performances/prix : davantage de tâches menées à bien pour un budget identique, ou des résultats comparables à un coût total moindre. Nous proposons également une nouvelle méthode pour accélérer les tâches les plus exigeantes : « ultra » est notre paramètre offrant les capacités les plus élevées, qui coordonne plusieurs agents sur des flux de travail parallèles afin d’accomplir plus rapidement des tâches complexes. Une utilisation plus intensive des ressources informatiques et un meilleur jugement en matière de conception font de GPT-5.6 Sol notre collaborateur le plus abouti à ce jour, lui permettant d’inspecter, d’affiner et de fournir des résultats prêts à l’emploi.

    Nous avons entraîné GPT-5.6 pour tirer davantage de travail utile de chaque token. Lors de l’« Agents’ Last Exam », une évaluation de flux de travail professionnels de longue durée dans 55 domaines, GPT-5.6 Sol établit un nouveau record de 53,6, surpassant Claude Fable 5 (raisonnement adaptatif) de 13,1 points. Même avec un niveau de raisonnement moyen, il devance Fable 5 de 11,4 points pour un coût estimé à environ un quart de celui de ce dernier. Cette efficacité s’étend aux modèles plus petits, essentiels pour rendre l’intelligence plus répandue et plus abordable : GPT-5.6 Terra et GPT-5.6 Luna surpassent Fable 5 pour un coût d’environ un seizième de celui-ci. Sur l’Artificial Analysis Intelligence Index⁠, une mesure globale de l’intelligence couvrant le travail agentique, le codage, le raisonnement scientifique et les capacités générales, le GPT-5.6 Sol avec un niveau de raisonnement maximal se situe à moins d’un point de Fable 5 tout en accomplissant les tâches en 61 % de temps en moins, pour environ la moitié du coût estimé.

    Nom : 1.jpg
Affichages : 585
Taille : 32,4 Ko

    GPT-5.6 est lancé avec nos mesures de sécurité les plus robustes à ce jour, conçues pour résister à des utilisations abusives déterminées et adaptatives sans pour autant limiter de manière générale le travail légitime. Avant sa mise à disposition générale, nous avons soumis les modèles et les mesures de sécurité à notre période d’évaluation la plus approfondie à ce jour, combinant des tests « red team » menés par des humains à des tests automatisés à grande échelle. Au cours de la phase de préversion, nous avons travaillé en étroite collaboration avec des organisations spécialisées et des partenaires de confiance afin de mettre à l’épreuve les défenses et de renforcer les mesures de sécurité avant un lancement à plus grande échelle. Le système ainsi obtenu superpose aux protections intégrées au modèle des contrôles en temps réel, une surveillance et un accès calibrés en fonction de la confiance et du risque.

    Efficace par défaut, performances maximales à la demande

    GPT-5.6 Sol est notre meilleur modèle de codage à ce jour. Sur l’indice Artificial Analysis Coding Agent (AACA), GPT-5.6 Sol, avec un raisonnement maximal, établit un nouveau record à 80, soit 2,8 points de plus que Fable 5, tout en utilisant moins de la moitié des tokens de sortie, en prenant moins de la moitié du temps et en coûtant environ un tiers de moins. Cet avantage s’étend à toute la gamme : Terra affiche des performances légèrement supérieures à celles de Fable 5, tandis que Luna surpasse Opus 4.8 ; chacun y parvient en environ un tiers du temps, avec environ la moitié du nombre de tokens de sortie, et pour environ un quart du coût estimé. Il établit également de nouveaux records de performance sur Terminal‑Bench 2.1 et DeepSWE, qui testent des workflows complexes en ligne de commande et l’ingénierie à long terme dans des bases de code réelles.

    Nom : 2.jpg
Affichages : 444
Taille : 37,7 Ko
    Nom : 3.jpg
Affichages : 442
Taille : 33,8 Ko

    GPT‑5.6 est capable d’écrire et d’exécuter des programmes légers qui coordonnent des outils, traitent les résultats intermédiaires, surveillent la progression et choisissent l’action suivante au fur et à mesure que le travail avance. Cela permet aux tâches nécessitant de nombreux outils d’avancer avec moins de tokens, moins d’allers-retours vers le modèle et moins de guidage. Au lieu d’obliger les développeurs à scriptifier chaque étape ou à renvoyer chaque réponse d’outil via le modèle, la fonctionnalité « Programmatic Tool Calling »⁠ de l’API Responses peut filtrer de grandes quantités de données intermédiaires, ne conserver que ce qui est pertinent et adapter son flux de travail au fur et à mesure.

    Pour les problèmes qui justifient un investissement plus important en temps et en puissance de calcul, GPT-5.6 peut aller au-delà de ce réglage par défaut déjà efficace. Le mode « max » accorde à GPT-5.6 encore plus de temps que le mode « xhigh » pour raisonner et explorer des alternatives, effectuer des vérifications et réviser son approche. Le mode « ultra » va encore plus loin en coordonnant quatre agents en parallèle par défaut, privilégiant une utilisation plus importante de jetons au profit de résultats plus solides et d’un délai d’obtention des résultats plus court sur les tâches exigeantes. Les graphiques ci-dessous comparent la configuration par défaut à quatre agents d’« ultra » à une configuration de référence à un seul agent sur les ensembles de données BrowseComp, SEC-Bench Pro et Terminal-Bench 2.1 ; BrowseComp et SEC-Bench Pro présentent également des configurations à 16 agents. Dans les trois évaluations, l’ajout d’agents parallèles déplace la courbe « score-latence » vers le haut et vers la gauche, permettant d’obtenir de meilleurs résultats en moins de temps. Dans l’API, les développeurs peuvent créer des expériences similaires à celles d’ultra en utilisant la version bêta multi-agents de l’API Responses.

    Nom : 4.jpg
Affichages : 449
Taille : 43,4 Ko
    Nom : 5.jpg
Affichages : 447
Taille : 28,4 Ko

    Renforcer la sûreté et la sécurité grâce aux capacités

    À mesure que les capacités des modèles augmentent, nous renforçons notre infrastructure de sécurité afin que l’intelligence avancée puisse rester largement utile, tout en soumettant les utilisations les plus risquées à un contrôle plus rigoureux. Pour le GPT-5.6, nous avons mis au point notre système de sécurité le plus robuste à ce jour, adapté aux capacités de chaque modèle et s’appuyant sur une puissance de calcul sans précédent.

    Les modèles GPT-5.6 sont plus performants que nos modèles précédents tant en biologie qu’en cybersécurité, mais ne franchissent pas le seuil « critique » dans aucune de ces deux catégories. En matière de cybersécurité, nos tests indiquent que GPT-5.6 est plus efficace pour détecter et corriger des vulnérabilités que pour mener de manière fiable des attaques autonomes de bout en bout contre des cibles bien protégées, ce qui donne aux défenseurs la possibilité de renforcer leurs systèmes avant que leurs faiblesses ne soient exploitées. En biologie, nos tests indiquent que GPT-5.6 peut soutenir la recherche légitime, mais qu’il ne dispose pas des capacités de bout en bout nécessaires pour créer, concevoir ou synthétiser une nouvelle menace hautement dangereuse.

    Ces deux domaines sont intrinsèquement à double usage. En cybersécurité, les mêmes capacités qui pourraient aider un attaquant à exploiter une vulnérabilité peuvent aider un défenseur à la détecter, à la reproduire et à mettre au point un correctif fiable. Un blocage excessif crée donc un risque de sécurité en soi. Il peut empêcher les défenseurs de tester les systèmes et de déployer des correctifs, tandis que les acteurs malveillants continuent d’utiliser d’autres modèles, notamment des modèles open source de plus en plus performants, ainsi que des outils bien établis. Des mesures de protection efficaces tiennent compte du contexte et des conséquences probables d’une requête, préservant ainsi le travail défensif légitime tout en appliquant des contrôles plus stricts lorsque les preuves indiquent un risque sérieux de préjudice.

    Les mesures de protection de GPT-5.6 sont organisées en plusieurs couches pour une plus grande précision et une meilleure redondance, et sont conçues pour s’adapter rapidement à l’apparition de nouvelles attaques. Les protections intégrées au modèle fonctionnent de concert avec des vérifications en temps réel, une surveillance continue et une application au niveau des comptes, afin d’aider le système à rester sécurisé même lorsqu’une couche particulière ne fonctionne pas comme prévu. Dans de nombreux systèmes, ce sont uniquement les signaux émis par les classificateurs qui déterminent ce qu’il faut bloquer, en s’appuyant sur des modèles moins intelligents et plus difficiles à modifier pour prévenir les préjudices. Notre approche ajoute un moniteur de raisonnement qui analyse la conversation pour déterminer s’il existe un risque de préjudice. Cette conception vise à permettre un fonctionnement défensif tout en bloquant les abus graves, les fonctionnalités les plus sensibles étant réservées aux utilisateurs vérifiés via Trusted Access. Comme certaines protections utilisent un raisonnement en phase de test, nous pouvons les mettre à jour rapidement pour combler les failles sans avoir à réentraîner les classificateurs à partir de zéro.

    Nous adoptons une approche plus prudente tout en continuant à renforcer le système contre les attaques adaptatives. Par rapport aux modèles précédents, nos mesures de sécurité GPT-5.6 Sol bloquent environ dix fois plus d’activités potentiellement nuisibles. Comme ces mesures peuvent créer des frictions pour une utilisation bienveillante, nous proposons dans ChatGPT et Codex une option permettant de réessayer facilement les requêtes sur des modèles aux capacités réduites, et nous continuerons à réduire l’impact de nos mesures de sécurité sur l’utilisation bienveillante tout en maintenant un niveau élevé de robustesse. Cela reflète notre approche de déploiement itérative : commencer de manière prudente et s’améliorer en fonction des enseignements tirés de l’utilisation en conditions réelles.

    Avant la mise à disposition générale, nous avons mené nos évaluations de sécurité les plus poussées à ce jour, notamment des tests approfondis de type « red teaming », des tests rigoureux des capacités et des mesures de sécurité menés avec des experts externes, ainsi qu’environ 700 000 heures de calcul sur des GPU A100e consacrées à des tests automatisés de type « red teaming » en boîte noire. Cela nous a permis d’explorer systématiquement les points faibles potentiels, de mettre au jour des failles de sécurité et de renforcer le système avant son lancement.

    La sécurité parfaite n’existe pas, et notre travail visant à sécuriser des modèles aux capacités toujours plus poussées se poursuit. De nouvelles failles seront découvertes, tout comme de nouvelles méthodes de contournement des mesures de protection existantes. Chaque nouvelle génération de modèle ouvrira également de nouvelles voies d’attaque et d’utilisation abusive. Nous nous préparons à cette réalité grâce à des mesures de protection multicouches, une surveillance continue, une correction rapide des failles et une collaboration au sein de la communauté de défense. Pour GPT-5.6, nous avons associé nos programmes existants de sécurité⁠ et de prime aux bogues biologiques⁠ à un nouveau processus de correction rapide et à notre effort de surveillance le plus intense à ce jour. Les conclusions des chercheurs, de la surveillance et des abus observés dans le monde réel alimenteront en permanence de nouvelles évaluations et des mesures de protection renforcées.

    Nom : 6.jpg
Affichages : 388
Taille : 47,0 Ko

    Disponibilité et tarifs

    GPT-5.6 se décline en trois niveaux de modèles : Sol, notre modèle phare ; Terra, un modèle plus économique dont les performances rivalisent avec celles de GPT-5.5 ; et Luna, notre modèle le plus rapide et le plus abordable. Le chiffre correspond à la génération, tandis que Sol, Terra et Luna désignent des niveaux de capacités durables pouvant évoluer à leur propre rythme.

    GPT-5.6 est disponible dès aujourd’hui sur ChatGPT, Codex et l’API OpenAI. Le déploiement commence dès maintenant à l’échelle mondiale et se poursuivra progressivement jusqu’à une disponibilité totale au cours des prochaines 24 heures.

    - Chat : les utilisateurs des formules Plus, Pro, Business et Enterprise ont accès à GPT-5.6 Sol avec des niveaux d’effort moyens ou supérieurs. Les utilisateurs Pro et Enterprise peuvent également sélectionner GPT-5.6 Sol Pro pour obtenir des résultats de la plus haute qualité sur des tâches complexes.
    - ChatGPT Work et Codex : les utilisateurs des formules Free et Go ont accès à GPT-5.6 Terra. Les utilisateurs des formules Plus, Pro, Business et Enterprise peuvent choisir entre GPT-5.6 Sol, Terra et Luna et définir un niveau d’effort pour chacun. Le niveau « max » est disponible pour tous les utilisateurs ayant accès à GPT-5.6 dans ChatGPT Work et Codex et peut être activé dans les paramètres. Dans ChatGPT Work, le mode « ultra » est disponible pour les utilisateurs Pro et Enterprise. Dans Codex, il est disponible pour les formules Plus et supérieures.
    - API : les développeurs peuvent accéder à Sol, Terra et Luna via l’API OpenAI. Dans l’API Responses, la fonctionnalité « Programmatic Tool Calling » permet à GPT-5.6 d’écrire et d’exécuter en mémoire des programmes qui coordonnent des outils et traitent les résultats intermédiaires, ce qui le rend compatible avec le principe de « Zero Data Retention » (ZDR). La fonctionnalité « Multi-agent », initialement disponible en version bêta, permet à GPT-5.6 d’exécuter simultanément des sous-agents et de synthétiser leur travail en une seule requête.

    Le tarif de GPT-5.6 est fixé par million de jetons pour trois tailles de modèles : Sol coûte 5 $ en entrée / 30 $ en sortie ; Terra coûte 2,50 $ en entrée / 15 $ en sortie ; et Luna coûte 1 $ en entrée / 6 $ en sortie. GPT-5.6 introduit également une mise en cache des prompts plus prévisible, avec notamment la prise en charge des points de rupture explicites du cache⁠ et une durée de vie minimale du cache de 30 minutes. Pour GPT-5.6 et les modèles ultérieurs, les écritures dans le cache sont facturées à 1,25 fois le tarif d’entrée non mise en cache du modèle, tandis que les lectures dans le cache continuent de bénéficier de la remise de 90 % sur les entrées mises en cache.

    Source : Annonce d'OpenAI

    Et vous ?

    Pensez-vous que cette annonce est crédible ou pertinente ?
    Quel est votre avis sur le sujet ?

    Voir aussi :

    Donald Trump obtient d'OpenAI qu'elle propose aux États-Unis une participation de 5 %, bien inférieure à l'objectif de Bernie Sanders, Sam Altman serait en pourparlers actifs avec l'administration Trump

    Anthropic lance Claude Sonnet 5, une solution plus économique pour faire fonctionner des agents IA : « Il est capable d'élaborer des plans, d'utiliser des outils tels que des navigateurs et des terminaux »

    Selon des chercheurs en sécurité, GLM-5.2 de la start-up chinoise spécialisée dans l'IA Z.ai est désormais capable de rivaliser avec Claude Mythos en matière de détection de failles de sécurité logicielle
    Publication de communiqués de presse en informatique. Contribuez au club : corrections, suggestions, critiques, ... Contactez le service news et Rédigez des actualités

Discussions similaires

  1. Réponses: 4
    Dernier message: 18/03/2026, 16h48
  2. Réponses: 0
    Dernier message: 14/03/2025, 14h13
  3. Réponses: 1303
    Dernier message: 25/02/2025, 22h19
  4. Réponses: 8
    Dernier message: 24/08/2020, 15h41
  5. Réponses: 3
    Dernier message: 29/07/2017, 13h23

Partager

Partager
  • Envoyer la discussion sur Viadeo
  • Envoyer la discussion sur Twitter
  • Envoyer la discussion sur Google
  • Envoyer la discussion sur Facebook
  • Envoyer la discussion sur Digg
  • Envoyer la discussion sur Delicious
  • Envoyer la discussion sur MySpace
  • Envoyer la discussion sur Yahoo