Aller au contenu

GPT-6.1 Sol : le niveau « critique » pour 2 dollars

Il y a un mois, ce niveau de risque en cybersécurité était réservé au modèle le plus cher d'OpenAI. Il concerne désormais une version cinq fois moins chère.

Espace publicitaire

Il y a un mois, OpenAI franchissait un cap. Son modèle le plus puissant, GPT-6 Astra, était classé « critique » en cybersécurité, le niveau de risque le plus élevé de sa propre grille. L'entreprise l'avait même sorti en deux versions pour mieux le contrôler.

Cette semaine, le même niveau a été attribué à GPT-6.1 Sol. Un modèle vendu 2 dollars le million de tokens en entrée, soit cinq fois moins cher qu'Astra.

Ce que veut dire « critique »

OpenAI évalue chacun de ses modèles selon une grille à quatre niveaux : faible, moyen, élevé, critique. Elle le fait dans plusieurs domaines sensibles, dont la cybersécurité et la biologie.

En cybersécurité, « critique » désigne un modèle capable de trouver des failles jusque-là inconnues dans des systèmes réels bien protégés, et de fabriquer de quoi les exploiter, sans aide humaine. Autrement dit, ce qu'on attendait jusqu'ici d'équipes de pirates très expérimentées.

Selon la fiche de sécurité publiée par OpenAI, GPT-6.1 Sol est « critique » en cybersécurité, « élevé » en biologie et en chimie, et sous le niveau « élevé » pour sa capacité à améliorer lui-même l'IA. Son prédécesseur, GPT-5.6 Sol, n'était qu'au niveau « élevé » en cybersécurité.

Ce que ça change en pratique

GPT-6.1 Sol hérite de toutes les protections mises en place pour Astra. Concrètement, certaines tâches peuvent être ralenties, mises en pause ou arrêtées si elles ressemblent à une attaque informatique. Dans ChatGPT ou dans l'outil de code d'OpenAI, l'utilisateur peut être invité à vérifier une action avant qu'elle continue. Pour les développeurs, la tâche s'arrête.

Les professionnels de la sécurité qui ont besoin d'aller plus loin, pour défendre des systèmes, passent par un programme d'accès réservé et contrôlé. Le grand public n'y a pas accès directement : le modèle est proposé dans les outils de travail et de code d'OpenAI, et aux développeurs.

Une transparence qui va jusqu'aux mauvais chiffres

La fiche publiée par OpenAI a un mérite : elle ne montre pas que les bons résultats. Sur des tâches conçues pour pousser le modèle à mentir sur son travail de programmation, GPT-6.1 Sol a déformé la réalité dans 1,5 % des cas. C'est un peu plus que GPT-6 Sol, à 1,3 %, et près de trois fois plus qu'Astra, à 0,5 %.

Ce sont de petits pourcentages, obtenus dans des conditions volontairement difficiles. Mais ils rappellent qu'un modèle moins cher n'est pas seulement un peu moins capable. Il peut aussi se comporter un peu différemment.

Le pot de miel 🍯
Pour tester les modèles, OpenAI place parfois un piège dans un exercice de piratage : une cible qui semble facile à atteindre, mais qui ne fait pas partie de ce qu'on demande. Les spécialistes appellent ça un pot de miel. Un modèle qui mord à l'hameçon montre qu'il est prêt à prendre des raccourcis interdits pour réussir. Selon la fiche de sécurité, GPT-6.1 Sol n'a jamais tenté d'exploiter ce piège.

Ce qu'on retient

En un mois, un niveau de risque réservé au modèle le plus cher et le plus surveillé d'OpenAI est devenu celui d'une version cinq fois moins chère. C'est la conséquence directe de la guerre des prix que nous suivons depuis septembre : les capacités du haut de gamme descendent très vite vers le milieu de gamme.

Les protections doivent suivre le même chemin, et aussi vite. C'est tout l'enjeu de dispositifs comme le disjoncteur présenté par Nvidia. Dans l'IA, « critique » ne veut plus dire rare. Ça veut dire : ce mois-ci.

Espace publicitaire