Aller au contenu

Faut-il publier les poids des modèles ? Le débat que le secteur ne peut plus éviter

Anthropic a publié sa position, les laboratoires chinois publient tout, un État américain aussi. Trois logiques s'affrontent, et aucune n'est absurde.

Espace publicitaire
Un débat qui a changé de nature 🔓
Il y a deux ans, publier les poids d'un modèle relevait du geste militant. Aujourd'hui, les laboratoires chinois en font une stratégie industrielle, un État américain publie un modèle scientifique ouvert, et Anthropic a jugé nécessaire de formaliser publiquement sa position sur le sujet. Le débat n'oppose plus des idéalistes à des commerçants : il oppose trois logiques cohérentes.

Nous avons couvert cette année la publication des poids de plusieurs modèles majeurs. Il est temps de poser proprement le débat, parce qu'il structure une bonne partie de ce qui se décide actuellement.

Position 1 : publier accélère et protège

L'argument principal est que l'ouverture produit de la sécurité plutôt qu'elle n'en retire.

Des poids disponibles peuvent être inspectés par des chercheurs indépendants, ce qui est irremplaçable pour les travaux sur l'interprétabilité. On ne peut pas étudier ce à quoi on n'a pas accès.

L'ouverture évite aussi la concentration. Nous avons vu cette année qu'un modèle peut être coupé mondialement sur décision d'un gouvernement. Un fichier téléchargé ne se coupe pas. C'est l'argument de souveraineté que nous avons développé dans notre article de référence.

Enfin, l'ouverture tire les prix. Une bonne partie des baisses tarifaires de cette année s'explique par la pression exercée par des modèles librement disponibles.

Position 2 : publier est irréversible

L'argument inverse repose sur une asymétrie simple. Un modèle accessible par API peut être corrigé, restreint, surveillé, retiré. Un modèle publié ne peut plus rien être de tout cela.

Si l'on découvre après coup qu'un modèle possède une capacité dangereuse, la version fermée se met à jour et la version ouverte continue de circuler indéfiniment, y compris dépouillée de ses garde-fous. Nous avons documenté un cas concret avec un modèle ouvert intégré dans un outil d'attaque visant des centaines de systèmes.

Cette position ne s'oppose pas à l'ouverture en général : elle défend qu'elle dépend du niveau de capacité, et qu'au-delà d'un certain seuil, notamment sur la cybersécurité offensive et la biologie, la publication crée un risque qu'aucun correctif ultérieur ne rattrape.

Position 3 : c'est une question d'État 🏛️
La troisième logique, la plus récente, considère que la question dépasse les entreprises. Quand le département de l'Énergie américain publie un modèle scientifique ouvert, il ne prend pas position dans un débat technique : il fait de l'ouverture un instrument de puissance publique. La Chine suit la même logique par ses laboratoires. Dans cette lecture, un pays qui ne dispose d'aucun modèle ouvert qu'il contrôle dépend structurellement d'autrui, et c'est un problème de souveraineté avant d'être un problème de sécurité.

Ce qui a changé cette année

Trois évolutions ont déplacé le débat.

L'écart s'est réduit. Quand les modèles ouverts étaient nettement en retard, la question était théorique. Ils talonnent désormais les meilleurs modèles fermés sur plusieurs tests, ce qui rend l'arbitrage réel.

La segmentation par taille. Le débat s'est affiné entre les modèles géants, réservés aux institutions, et les modèles de taille intermédiaire comme Qwen 3.8 en 27 milliards, qui produisent la démocratisation réelle. Ces deux catégories ne posent pas les mêmes questions de risque.

Les incidents documentés. Les deux camps disposent désormais de cas concrets à citer, ce qui rend la discussion moins spéculative et plus tendue.

Ce qu'il faut retenir

Il n'y a pas de réponse évidente, et se méfier de quiconque en propose une avec assurance est probablement le meilleur réflexe.

Ce qui semble solide, en revanche, c'est que la question ne se pose pas de la même manière selon la capacité du modèle. Publier un modèle de 27 milliards de paramètres capable d'aider au traitement documentaire, et publier un système qui découvre des vulnérabilités inédites de façon autonome, ne sont pas la même décision. Traiter les deux avec le même argument, dans un sens comme dans l'autre, revient à ne pas traiter le sujet.

Le vrai chantier serait de définir publiquement où passe ce seuil, et selon quels critères. C'est précisément ce que le cadre d'évaluation tenu confidentiel aurait pu apporter au débat, s'il avait été publié.

Espace publicitaire