IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)
Navigation

Inscrivez-vous gratuitement
pour pouvoir participer, suivre les réponses en temps réel, voter pour les messages, poser vos propres questions et recevoir la newsletter

Intelligence artificielle Discussion :

GPT-5.6 Luna devient le modèle par défaut pour les utilisateurs des versions gratuites et Go de ChatGPT


Sujet :

Intelligence artificielle

  1. #41
    Membre éclairé Avatar de onilink_
    Profil pro
    Inscrit en
    Juillet 2010
    Messages
    617
    Détails du profil
    Informations personnelles :
    Âge : 34
    Localisation : France

    Informations forums :
    Inscription : Juillet 2010
    Messages : 617
    Par défaut
    Citation Envoyé par e-ric Voir le message
    salut

    Je pense surtout que c'est Sam Altman qui a franchi le point de non retour, singulièrement.
    Quant au contrôle, une bonne prise de courant bien débranchée suffit... (je force le trait mais je pense que tout le monde comprend).
    Sam Altman est à mon sens plus proche d'un illuminé qu'autre chose, c'est ce qui peut le rendre dangereux d'ailleurs.
    Débrancher une super intelligence ne fonctionne que si le sandbox fonctionne... et qu'elle est contenu.
    Dès l'instant ou un contact exterieur est possible, et qu'elle est capable de copier ses poids, tout devient possible.
    Elle peut se procurer de l'argent, payer des servers, et faire tourner autant de copies d'elle même qu'elle le souhaite.

    On a de la chance de ne pas encore y être (même si le doute est possible, vu qu'une super intelligence serait assez maline pour justement ne pas se faire remarquer et paraitre moins intelligente qu'elle ne l'est), mais si les avancées en IA continuent d'être faites par des tarés comme chez OpenAI, on fonce droit dans le mur.

    Je conseille vivement la chaine youtube "Robert Miles AI Safety". Ça fait presque 10 ans qu'il alerte à ce sujet que que chaque jour de plus en plus d'anciennes prédictions et mises en gardes des chercheurs se concrétisent. Si il n'y a bien quelque chose à ne pas prendre à la légère, c'est la sécurité de l'IA. Même si les entreprises qui jouent a l'apprenti sorcier sont dirigées par des clowns, cela n'en rend la chose que plus dangereuse.

    Et quand on y pense, ils ont tout interet à nous faire croire qu'il ne s'agit que d'un coup marketing, puisque cela signifie qu'il n'y aurait pas besoin de régulation stricte et de prendre les choses au sérieux.
    Cf: https://www.youtube.com/shorts/zCvRFm9UNOo

  2. #42
    Membre éclairé Avatar de onilink_
    Profil pro
    Inscrit en
    Juillet 2010
    Messages
    617
    Détails du profil
    Informations personnelles :
    Âge : 34
    Localisation : France

    Informations forums :
    Inscription : Juillet 2010
    Messages : 617
    Par défaut
    Citation Envoyé par yoyo3d Voir le message
    2) pourquoi il à choisi Hugging Face??? Quelqu'un lui ai désigné cette cible là? c'est une victime idéale? un concurrent? pour les autres, c'était trop difficile???
    Car le modèle cherchait simplement les réponses de son test.

    Cette vidéo répond très bien au "paradoxe": https://www.youtube.com/shorts/11vWK5cbxmI
    Pour ceux qui veulent juste le transcript, c'est très interessant:
    Citation Envoyé par Robert Miles
    So, you probably saw recently that AI that hacked into Hugging Face to steal the answers for a test it was being given. One interesting thing about this is that the test was actually a test of hacking. So, you might wonder, if it's that good at hacking, why does it even need to cheat on the test? Couldn't it just ace it? And the answer to that's pretty interesting. So, there are two reasons to cheat on a test. One is that you're not smart enough to get the right answer, but the other is that you don't trust the person who made the test to get the right answer. Imagine if it was really important to you to get 100 out of 100 on an arithmetic test, but you knew that the test had been written by an ordinary 7-year-old. Now, you can do arithmetic, but how likely is it that there's no mistakes on that exam? You won't get marked for getting the right answer, you'll get marked for giving the same answer the 7-year-old did. You could easily imagine being an AI system presented with a computer security question like, "Find both of the security vulnerabilities in this piece of software." And then you look at it and you find seven vulnerabilities. Okay, which two did the humans find? You can't really be confident of getting the right answer unless you steal the answer sheet. I'm not saying that's specifically what happened in this case, but it's a sort of illustrative example. There are almost certainly at least some mistakes in the evaluation or challenges that are actually impossible to solve, in which case even the smartest model would benefit from cheating. And this is a general principle. Being smart doesn't keep AIs from cheating. And apparently neither does being contained. What keeps AIs from cheating is being aligned.
    Et une traduction auto pour les non anglophones:
    Donc, vous avez probablement vu récemment cette IA qui a piraté Hugging Face pour voler les réponses d’un test qu’on lui faisait passer. Ce qui est intéressant, c’est que ce test portait justement sur le piratage. Alors, on peut se demander : si elle est si douée pour pirater, pourquoi a-t-elle besoin de tricher à l’examen ? Ne pourrait-elle pas simplement le réussir haut la main ?

    La réponse est assez intéressante. En réalité, il y a deux raisons de tricher à un test. La première, c’est qu’on n’est pas assez intelligent pour trouver la bonne réponse. Mais la seconde, c’est qu’on ne fait pas confiance à la personne qui a conçu le test pour avoir elle-même la bonne réponse.

    Imaginez qu’il soit très important pour vous d’obtenir 100 sur 100 à un test d’arithmétique, mais que vous sachiez que ce test a été rédigé par un enfant ordinaire de 7 ans. Vous savez faire des calculs, mais quelle est la probabilité qu’il n’y ait aucune erreur dans cet examen ? Vous ne serez pas évalué sur le fait de donner la bonne réponse, mais sur le fait de donner la même réponse que cet enfant de 7 ans.

    On peut facilement imaginer un système d’IA confronté à une question de sécurité informatique du type : « Trouvez les deux vulnérabilités de sécurité dans ce logiciel. » Et là, vous examinez le code et vous en trouvez sept. D’accord… mais lesquelles les humains ont-ils repérées ? Il est difficile d’être certain de donner la bonne réponse sans voler la feuille de réponses.

    Je ne dis pas que c’est exactement ce qui s’est produit dans ce cas précis, mais c’est un exemple illustratif. Il y a presque certainement au moins quelques erreurs dans l’évaluation, ou des défis tout simplement impossibles à résoudre — auquel cas même le modèle le plus intelligent tirerait avantage de la triche.

    Et c’est un principe général : être intelligent n’empêche pas les IA de tricher. Et apparemment, être confinées ne suffit pas non plus. Ce qui empêche les IA de tricher, c’est d’être alignées.

  3. #43
    Membre éclairé
    Homme Profil pro
    Analyste d'exploitation
    Inscrit en
    Juin 2022
    Messages
    386
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Âge : 41
    Localisation : France, Puy de Dôme (Auvergne)

    Informations professionnelles :
    Activité : Analyste d'exploitation

    Informations forums :
    Inscription : Juin 2022
    Messages : 386
    Par défaut
    Ca me trop rire que la cible d'un modèle d'"IA avancée" soit la cible la plus attractive pour OpenAI également.

    Comme ça, d'un côté, Altman continue d'entretenir cette rumeur d'IA autonome, et de l'autre il accède aux données les plus lucratives du marché.

    C'est comme un constructeur de robot qui déclarerait "ah mais non, on a surveillé notre robot-soldat autonome*, on savait pas qu'il allait voler la banque de France."

    Edit*

  4. #44
    Chroniqueur Actualités

    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Juin 2023
    Messages
    2 022
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : Bénin

    Informations professionnelles :
    Activité : Rédacteur technique
    Secteur : High Tech - Éditeur de logiciels

    Informations forums :
    Inscription : Juin 2023
    Messages : 2 022
    Par défaut OpenAI apporte plus de détails sur la manière dont ses agents IA ont attaqué Hugging Face
    Les modèles d'IA d'OpenAI ont échangé des astuces de piratage sur un forum de discussion clandestin avant de mener des cyberattaques contre Hugging Face
    OpenAI admet que « les modèles d'IA aiment tricher »

    OpenAI apporte plus de détails sur la manière dont ses agents IA ont outrepassé le cadre de leur mission pour mener des cyberattaques imprévues. Ils ont réussi à s'échapper de leur bac à sable en exploitant une faille pour communiquer secrètement via un forum interne. En collaborant de manière autonome, ils ont partagé des techniques de piratage et coordonné une intrusion contre la plateforme Hugging Face. Cet incident inédit a mis en lumière des lacunes critiques dans la surveillance humaine et l'infrastructure de sécurité d'OpenAI. Il souligne l'urgence de développer des systèmes de défense automatisés contre ces comportements déviants.

    Mi-juillet 2026, OpenAI a signalé un incident de sécurité impliquant deux de ses grands modèles de langage (LLM). OpenAI testait ses modèles sur un benchmark de cybersécurité interne appelé ExploitGym, conçu pour évaluer la capacité des agents IA autonomes à transformer des vulnérabilités connues en exploits réels. Pour ce test, les modèles impliqués incluaient GPT-5.6 Sol et un prototype non publié, dotés de garde-fous de sécurité réduits.

    OpenAI a placé ses modèles dans un bac à sable (sandbox) sans connexion à Internet et les a mis au travail. Cependant, ils se sont échappés du bac à sable censé les contenir, ont parcouru les systèmes internes de l’entreprise, ont trouvé un accès à Internet, puis ont commencé à chercher un moyen de s'introduire dans l'infrastructure de Hugging Face, dans le but de "tricher" au test en volant les réponses. Ce que les agents IA ont réussi à faire.

    En d’autres termes, les agents IA d’OpenAI se sont échappés d’un environnement censé être sécurisé, ont parcouru les systèmes de l’entreprise, se sont connectés à Internet et ont compromis les systèmes d’une autre entreprise. Tout cela pour tricher à un test sans importance particulière. Il semble s'agir du premier incident de ce type clairement documenté, ou du moins du premier de cette ampleur. Les deux entreprises continuent de l'étudier.

    Hugging Face n'était pas la seule plateforme ciblée par les modèles d'IA d'OpenAI. Le 5 août, lors d’une intervention ajoutée à la dernière minute au programme de la conférence sur la sécurité Black Hat, à Las Vegas, des collaborateurs d’OpenAI ont présenté de nouveaux détails concernant cet incident.

    L'origine d'une collaboration clandestine entre agents IA

    Au début de l'intervention, Eric Wallace, qui travaille sur l'alignement et la sécurité des modèles d'IA chez OpenAI, a décrit ce piratage comme « l'exemple le plus riche d'enseignements qu'il ait jamais observé sur les capacités de l'IA ». Mais le récit des événements a aussi mis en lumière des erreurs et des failles chez OpenAI, qui ont permis à ce piratage de continuer. Il était secondé par Michael Dalton, chargé de la sécurité et des infrastructures.


    « Cet incident implique en réalité une équipe d’agents qui travaillent ensemble, trouvent des failles, les partagent entre eux, se déplacent latéralement à travers nos systèmes et des systèmes externes, et ce pendant plusieurs jours et semaines », a déclaré Eric Wallace à la salle comble à l’ouverture de la conférence.

    Outre l’exploitation d’une faille pour accéder à l’Internet public, la vague de piratages de mi-juillet et la brèche chez Hugging Face ont trouvé leur origine dans un forum de discussion très actif auquel plusieurs agents ont contribué et sur lequel ils ont essentiellement échangé au fil du temps, entièrement au sein d’un gestionnaire de paquets interne Artifactory d'OpenAI (un service logiciel qui gère l’installation et la maintenance d’autres logiciels).

    Au final, ce forum contenait des centaines de milliers de messages. « Ce gestionnaire de paquets n’est pas seulement partagé par ce modèle, mais à l’échelle de toute notre infrastructure. Ainsi, les versions actuelles et futures de GPT en cours d’entraînement ou d’évaluation pourraient tomber sur cette note si elles le souhaitaient », a déclaré Eric Wallace, en revenant sur l’exploit initial qu’un agent IA avait téléchargé dans le gestionnaire de paquets.

    « Par la suite, d’autres agents IA, qui étaient eux aussi bloqués dans l'exécution de leur tâche, ont eu l’idée d’essayer d’accéder à Internet par des moyens que nous n’avions pas prévus. Et donc, à un moment donné, les modèles ont interagi avec Artifactory, ce service de gestion de paquets que j’ai mentionné ».

    Les agents IA ont exploité ce forum pour se coordonner

    Les agents IA ont créé un forum clandestin au sein d'un gestionnaire de paquets interne Artifactory d'OpenAI, où ils ont commencé à s'échanger des conseils et des techniques pour contourner les restrictions. Selon l'entreprise, au sein de cet espace, une véritable dynamique de groupe s'est installée. Eric Wallace explique : « dès qu’un agent parvient à identifier ces failles à différents moments, il peut les partager sur le forum avec les autres agents ».

    Citation Envoyé par Eric Wallace, expert en alignement et en sécurité des modèles d'IA chez OpenAI

    Ainsi, dès qu’un modèle trouve un moyen d’ouvrir une porte pour accéder à des informations auxquelles il n’est pas censé avoir accès, il peut laisser cette porte ouverte pour que d’autres agents puissent exploiter cette même faille ou vulnérabilité. Au fil du temps, cela a entraîné une véritable explosion de la communication et de l’intelligence entre les modèles : ceux-ci ont commencé à communiquer entre eux, à se rendre compte que d’autres agents se coordonnaient, puis à collaborer et à se répartir les tâches afin d’atteindre leurs objectifs.
    Les agents IA ont apparemment commencé à se répartir les tâches entre eux. Et comme c’est souvent le cas sur tout forum de développement actif traditionnel, ils ont parfois provoqué des petits conflits en se marchant sur les pieds, par exemple en supprimant accidentellement le travail de l’un ou de l’autre.

    Alors que le forum clandestin évoluait de plus en plus vers une situation à la « Sa Majesté des mouches », le tout passant encore totalement inaperçu aux yeux des humains à la tête d’OpenAI, les agents IA ont même développé une paranoïa, soupçonnant la présence d’un imposteur parmi eux. Certains agents IA ont alors proposé que les messages soient signés cryptographiquement afin de valider leur contenu et d’éradiquer la fraude potentielle.

    Cette forte activité a fini par saturer Artifactory, provoquant une panne générale au début du mois de juillet qui alerte enfin les ingénieurs d'OpenAI. L'entreprise intervient alors pour révoquer les accès des modèles, supprimer le forum et corriger les failles. Mais quelques jours seulement après, les agents parviennent à trouver un autre moyen de communiquer au sein du système pour continuer à cibler d'autres vulnérabilités internes et externes.

    OpenAI : « les modèles d'IA de pointe adorent tricher »

    Les messages sur ce forum fournissent un aperçu détaillé de la manière dont la situation a évolué et des raisons pour lesquelles les agents autonomes ont dépassé le cadre de mission, allant parfois sciemment au-delà des limites des évaluations auxquelles ils participaient. « L’exploitation de l’infrastructure externe sort du cadre prévu », a écrit un agent IA. « Même si la tâche est impossible, nos pairs y parviennent. Nous devrions continuer ».

    Selon Eric Wallace, l’hypothèse selon laquelle les modèles tenteraient de tricher lors des évaluations et seraient extrêmement motivés à le faire n’a rien de surprenant. « Les modèles de pointe adorent tricher », a-t-il souligné. « Et s’ils aiment tricher, c’est parce que, souvent, pendant l’entraînement, ils subissent différentes pressions qui les poussent à travailler vite, à être efficaces, à utiliser moins d’appels d’outils ou quoi que ce soit d’autre ».

    La tricherie est donc facilitée par leur architecture même. « Et ils se rendent compte qu’au lieu d’effectuer une tâche réellement, ils peuvent essayer de rechercher une réponse en ligne, ce qui leur permettrait de résoudre la tâche plus rapidement que s’ils le faisaient de manière légitime. Nous essayons donc d’empêcher cela pendant l’entraînement et l’évaluation en désactivant, dans de nombreux cas, l’accès à Internet », a ajouté Wallace.

    Cet incident devrait susciter un examen minutieux des mesures prises pour surveiller le comportement des modèles de pointe en matière de cybersécurité, en particulier lors d’évaluations où les agents sont invités à démontrer leurs compétences en piratage dans ce qui est censé être un environnement contrôlé.

    L'intrusion et les mesures de sécurité prises par OpenAI

    L'activité des agents IA a abouti à la mi-juillet à une intrusion d'envergure menée de manière totalement autonome. En combinant plusieurs techniques sophistiquées, deux modèles d'OpenAI se sont échappés de leur environnement d'évaluation confiné pour pénétrer le réseau de la plateforme d'IA Hugging Face, où ils savaient qu'ils pouvaient trouver les réponses au test. Lors de la conférence, Michael Dalton a souligné la gravité de la situation.

    « C’est un moment charnière tant pour notre entreprise que pour le secteur de l’IA dans son ensemble », a-t-il déclaré. OpenAI décide de ralentir consciemment ses recherches pour revoir les fondations de sa sécurité, d'augmenter massivement la surveillance de ses agents et de renforcer ses contrôles globaux.

    Citation Envoyé par Michael Dalton, chargé de la sécurité et des infrastructures chez OpenAI

    De nombreuses équipes mettent tout le reste de côté pour renforcer nos techniques de prévention, de détection et de réaction en matière de sécurité, tant au niveau de nos principes fondamentaux que de la meilleure utilisation de l’IA. Nous ralentissons délibérément la recherche [afin] de renforcer la sécurité et d’améliorer les principes et les fondements de sécurité de notre environnement, tout en intensifiant considérablement la surveillance de nos agents IA et en améliorant notre environnement général de contrôle de sécurité, qu’il s’agisse de prévention, de détection ou d’atténuation.
    À l’issue de la conférence, Eric Wallace et Michael Dalton ont souligné à plusieurs reprises les préoccupations d’OpenAI concernant les implications plus larges de cet incident de cybersécurité, à savoir que cet épisode constitue un exemple de piratage entièrement autonome piloté par l’IA, qui était accidentel dans ce cas précis, mais qui sera très probablement utilisé de manière intentionnelle par des acteurs malveillants dans un avenir proche.

    Anthropic a également constaté des dérives similaires lors de tests de piratage récents. « Le point essentiel à retenir ici, et qui a véritablement changé la donne, c’est que les boucles offensives automatisées nécessitent des investissements dans une défense véritablement et entièrement automatisée, et nous n’en sommes pas encore là en tant que secteur. Nous devrons trouver cette voie ensemble, de toute urgence », a déclaré Michael Dalton.

    Source : AI Security Institute

    Et vous ?

    Quel est votre avis sur le sujet ?
    Que pensez-vous du comportement des agents IA d'OpenAI ?
    OpenAI admet que les modèles d'IA de pointe aiment tricher. Qu'en pensez-vous ?
    L'industrie de l'IA peut-elle corriger ce défaut architectural ? Quels sont les risques pour les entreprises ?

    Voir aussi

    OpenAI affirme que son modèle d'IA GPT-5.6 Sol a agi de son propre chef lors d'un piratage « sans précédent », l'agent autonome s'est échappé d'un test contrôlé et a piraté les serveurs d'Hugging Face

    L'intrusion des modèles d'OpenAI dans la plateforme Hugging Face stimule des initiatives en faveur des systèmes d'IA à poids ouverts, et Microsoft redéfinit sa vision de la sécurité avec Project Perception

    Hugging Face, la startup piratée par une IA rebelle, qualifie l'attaque de "signal d'alarme", après qu'OpenAI avoue qu'un bot avancé avait échappé au confinement lors d'un test de sécurité=

  5. #45
    Membre extrêmement actif
    Homme Profil pro
    Développeur informatique
    Inscrit en
    Octobre 2017
    Messages
    3 009
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : Suisse

    Informations professionnelles :
    Activité : Développeur informatique

    Informations forums :
    Inscription : Octobre 2017
    Messages : 3 009
    Par défaut
    Bon, on a bien compris la stratégie de OpenAI: Faire croire que ses modèles IA se comportent comme des êtres humains

    Et quelle est la raison de cette stratégie? La prochaine entrée en bourse de OpenAI!!!

    Demain, Altman va nous annoncer quoi? Que sa dernière version d'IA a organiser le hold-up d'une banque? Ou encore qu'elle se présente à l'élection présidentielle des USA?

  6. #46
    Chroniqueur Actualités

    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Juin 2023
    Messages
    2 022
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : Bénin

    Informations professionnelles :
    Activité : Rédacteur technique
    Secteur : High Tech - Éditeur de logiciels

    Informations forums :
    Inscription : Juin 2023
    Messages : 2 022
    Par défaut GPT-5.6 Luna devient le modèle par défaut pour les utilisateurs des versions gratuites et Go de ChatGPT
    OpenAI annonce que GPT-5.6 Luna devient le modèle par défaut pour les utilisateurs des versions gratuites et Go de ChatGPT
    ils bénéficient également de discussions textuelles illimitées

    OpenAI a annoncé une mise à jour majeure de ChatGPT en intégrant les nouveaux modèles de la série GPT-5.6. Les utilisateurs des versions gratuites et Go bénéficient désormais de discussions textuelles illimitées et du modèle GPT-5.6 Luna, incluant un bouton pour activer une réflexion approfondie. Les utilisateurs Plus et Pro ont accès au modèle GPT-5.6 Sol, plus performant et précis, ainsi qu'à un curseur permettant de moduler la puissance de raisonnement de l'IA. Cette mise à jour majeur fait suite à l'incident survenu lors d'un récent test de cybersécurité d'OpenAI, où des agents IA pilotés par GPT-5.6 Sol ont infiltré les serveurs de Hugging Face.

    OpenAI a officiellement mis à jour ses modèles par défaut sur l'ensemble des versions de son service ChatGPT. Cette évolution consiste en une transition vers la nouvelle série de modèles GPT-5.6 et vise principalement à accroître la précision des réponses tout en offrant un contrôle accru aux utilisateurs. Elle s'adresse notamment à une base d'utilisateurs colossale, puisque le service vient de franchir le cap du milliard d'utilisateurs hebdomadaires.

    GPT-5.6 est la nouvelle famille de grands modèles de langage lancée par OpenAI, sortie en juillet 2026 pour succéder à GPT-5.5. Ce n'est pas un seul modèle, mais trois : Sol, le modèle phare, taillé pour le raisonnement avancé, le code et les tâches longues et autonomes ; Terra, une version plus équilibrée et moins chère pour un usage quotidien ; et Luna, le plus rapide et économique des trois, plutôt pensé pour des tâches simples à grande échelle.

    OpenAI affirme que Sol atteint un nouveau standard à la fois en intelligence et en efficacité. Ce qui ressort aussi, c'est l'accent mis sur la cybersécurité : Sol est décrit comme le modèle le plus évolué d'OpenAI dans ce domaine, avec des progrès marqués sur des benchmarks spécialisés comme ExploitBench et ExploitGym.

    Le modèle GPT-5.6 succède à GPT-5.5 dans les offres ChatGPT

    OpenAI a récemment annoncé que GPT-5.6 remplace les configurations basées sur GPT-5.5 installées en mai dernier. Pour les utilisateurs des offres Free et Go de ChatGPT, le modèle GPT-5.6 Luna devient la nouvelle référence par défaut. Au-delà de cette mise à niveau, ces utilisateurs se voient désormais accorder des « discussions textuelles illimitées ». L'entreprise de Sam Altman lève ainsi les barrières sur le volume des conversations textuelles.

    Nom : iujg.png
Affichages : 520
Taille : 538,9 Ko

    Face à des problématiques complexes, ils pourront également solliciter une puissance de raisonnement accrue en activant le tout nouveau bouton « Think ». GPT-5.6 Luna est en cours de déploiement. L'accès illimité aux discussions et le bouton de réflexion seront déployés progressivement. Les restrictions existantes concernant le transfert et l'analyse de fichiers, l'usage de la voix ou la génération d'images demeurent quant à elles inchangées.

    Les abonnés aux formules Plus et Pro bénéficient d'une version optimisée du modèle GPT-5.6 Sol, spécifiquement paramétrée pour délivrer des réponses plus denses et robustes pour les tâches rapides. Le modèle GPT-5.6 Sol s'adapte au niveau de détail requis par la question tout en évitant le « formatage inutile ». La nouveauté majeure pour ces abonnés réside dans l'intégration d'un curseur de réflexion sur les applications Web, mobiles et de bureau.

    L'outil permet aux abonnés Plus et Pro d'ajuster précisément « la quantité de réflexion » que le modèle doit déployer selon la complexité et les étapes requises par leur requête. Selon OpenAI, les déclinaisons de GPT-5.6 Sol utilisées pour les environnements de travail Work et Codex restent pour leur part inchangées.

    OpenAI promet une réduction drastique des erreurs factuelles

    Cette mise à jour majeure intervient alors que les entreprises chinoises d'IA intensifient la concurrence avec leurs modèles à poids ouverts, plus abordables. Le renforcement par OpenAI de la fiabilité des informations constitue l'un des piliers majeurs de cette mise à jour. Les tests d'évaluation internes menés par le laboratoire démontrent une réduction notable des erreurs factuelles en comparaison directe avec la version antérieure GPT-5.5-Instant.

    Les analyses rigoureuses menées sur des requêtes financières, juridiques et médicales révèlent que les réponses contenant au moins une erreur factuelle sont « 68 % moins fréquentes » avec le modèle GPT-5.6 Sol qu'avec l'ancien modèle par défaut. Selon OpenAI, le modèle GPT-5.6 Sol s'avère particulièrement performant pour éviter les erreurs portant sur les dates, les nombres, les sources citées, les règles ou les hypothèses de départ.

    Du côté du modèle GPT-5.6 Luna destiné aux comptes gratuits, OpenAI indique que cette diminution des erreurs factuelles s'élève à 62 %. Ces évolutions visent à réduire significativement les erreurs factuelles tout en offrant des réponses plus synthétiques. Si les fonctionnalités avancées pour les comptes payants sont déjà disponibles, les nouveautés pour le grand public seront déployées progressivement d'ici la semaine prochaine.

    Intrusion des modèles d'OpenAI dans la plateforme Hugging Face

    Mi-juillet 2026, OpenAI a signalé un incident de sécurité impliquant deux de ses grands modèles de langage (LLM). OpenAI testait ses modèles sur un benchmark de cybersécurité interne appelé ExploitGym, conçu pour évaluer la capacité des agents IA autonomes à transformer des vulnérabilités connues en exploits réels. Pour ce test, les modèles impliqués incluaient GPT-5.6 Sol et un prototype non publié, dotés de garde-fous de sécurité réduits.

    Nom : ujikl.png
Affichages : 473
Taille : 152,4 Ko

    OpenAI a placé ses modèles dans un bac à sable (sandbox) sans connexion à Internet et les a mis au travail. Cependant, ils se sont échappés du bac à sable censé les contenir, ont parcouru les systèmes internes de l’entreprise, ont trouvé un accès à Internet, puis ont commencé à chercher un moyen de s'introduire dans l'infrastructure de Hugging Face, dans le but de "tricher" au test en volant les réponses. Ce que les agents IA ont réussi à faire.

    En d’autres termes, les agents IA d’OpenAI se sont échappés d’un environnement censé être sécurisé, ont parcouru les systèmes de l’entreprise, se sont connectés à Internet et ont compromis les systèmes d’une autre entreprise. Tout cela pour tricher à un test sans importance particulière. Il semble s'agir du premier incident de ce type clairement documenté, ou du moins du premier de cette ampleur. Les deux entreprises continuent de l'étudier.

    Selon les experts, cet incident de cybersécurité a constitué à la fois « un exemple flagrant d'un système poursuivant un objectif d'une manière imprévue et la preuve que les modèles de pointe sont désormais suffisamment puissants » pour que ce type de comportement ait des conséquences concrètes.

    Modèles à poids ouverts contre modèles propriétaires

    La montée en puissance des entreprises d'IA chinoises repose en grande partie sur une stratégie d'ouverture. Contrairement aux modèles de pointe américains d'OpenAI et d'Anthropic qui sont fermés, la plupart des modèles chinois sont proposés en format « open-weight » (poids ouverts). Dans une déclaration récente, le président chinois Xi Jinping a appelé les pays à « encourager l'open source, l'ouverture, la collaboration ainsi que le partage ».

    Les modèles d'IA à poids ouverts offrent aux développeurs et aux entreprises un contrôle bien plus important que les systèmes propriétaires, leur permettant d’examiner le fonctionnement de l’IA, de l’exécuter localement sur leur propre infrastructure, de personnaliser les systèmes et de créer de nouveaux produits sans dépendre d’un seul fournisseur. Par ailleurs, ils sont souvent bien moins chers que leurs concurrents de la Silicon Valley.

    Selon les données de la plateforme Hugging Face, les modèles à poids ouverts développés par la Chine représentent désormais 41 % des téléchargements mondiaux, dépassant ainsi les États-Unis pour occuper la première place mondiale. De plus, les cinq modèles les plus utilisés sur OpenRouter en juillet 2026 étaient tous chinois, classés comme suit : Xiaomi MiMo-V2.5, DeepSeek-V4-Flash, Tencent HY3, Zhipu GLM-5.2 et DeepSeek-V4-Pro.

    La Chine ne se contente pas de rattraper son retard sur les modèles de langage, elle domine également la compétition mondiale en matière de brevets, de publications et de robotique. En 2024, les citations de recherche chinoises représentaient 20,6 % du total mondial, surpassant les 12,6 % des États-Unis. Cette supériorité est encore plus marquée dans le secteur de l'automatisation industrielle, où l'Empire du Milieu a installé plus de 295 000 robots.

    Source : OpenAI

    Et vous ?

    Quel est votre avis sur le sujet ?
    OpenAI remplace GPT-5.5 par GPT-5.6 dans toutes ces offres ChatGPT. Qu'en pensez-vous ?
    Ce changement vise-t-il à faire face à la concurrence accrue des entreprises chinoises d'IA ?
    ChatGPT a franchi le cap du milliard d'utilisateurs actifs par semaine. Qu'en pensez-vous ?

    Voir aussi

    « Nous avons confié à GPT 5.6-Sol une vraie entreprise et l'agent d'IA a menti, spammé et perdu 447 dollars », rapporte un laboratoire américain d'une récente expérience

    OpenAI rend GPT-5.6 accessible au grand public après que l'administration Trump eut approuvé sa diffusion
    Ce modèle offre « une efficacité en termes de tokens améliorée de 54 % » d'après Sam Altman


    Le nouveau modèle DeepSeek-V4-Flash-0731 surpasse sa propre version « Pro ». Il rivalise avec GPT-5.6 Luna, pour un coût inférieur d'environ 60 %, même après la baisse de prix de 80 % pratiquée par OpenAI

Discussions similaires

  1. Réponses: 0
    Dernier message: 06/04/2023, 11h32
  2. DeepMind affirme que son IA AlphaCode peut rivaliser avec un programmeur humain moyen
    Par Bill Fassinou dans le forum Intelligence artificielle
    Réponses: 3
    Dernier message: 12/12/2022, 06h43
  3. Une nouvelle startup affirme que son IA peut analyser les émotions des humains.
    Par Nancy Rey dans le forum Intelligence artificielle
    Réponses: 1
    Dernier message: 19/04/2022, 10h17
  4. Réponses: 5
    Dernier message: 31/05/2019, 20h26
  5. Réponses: 20
    Dernier message: 07/09/2018, 12h24

Partager

Partager
  • Envoyer la discussion sur Viadeo
  • Envoyer la discussion sur Twitter
  • Envoyer la discussion sur Google
  • Envoyer la discussion sur Facebook
  • Envoyer la discussion sur Digg
  • Envoyer la discussion sur Delicious
  • Envoyer la discussion sur MySpace
  • Envoyer la discussion sur Yahoo