Aller au contenu

Aujourd'hui à 17h59, des milliers d'intégrations DeepSeek vont cesser de fonctionner

Deux noms de modèles disparaissent définitivement de l'API. Le correctif tient en une ligne de code, mais un piège attend ceux qui iront trop vite.

Espace publicitaire
À vérifier aujourd'hui si vous développez ⏰
Le 24 juillet 2026 à 15h59 UTC, soit 17h59 heure de Paris, les identifiants deepseek-chat et deepseek-reasoner deviennent définitivement inaccessibles. Toute requête les utilisant renverra une erreur. Pas de période de grâce, pas de repli automatique. Si vous avez du code qui appelle l'API de DeepSeek, c'est le moment de le vérifier.

Il existe une catégorie d'actualité technologique qui ne fait pas de bruit mais casse des systèmes en production : la fin de vie d'un identifiant d'API. Aujourd'hui, c'est au tour de DeepSeek. Voici ce qui change, comment s'y adapter en quelques minutes, et le piège qui attend ceux qui migreront trop vite.

Ce qui se passe exactement

Le 24 avril 2026, DeepSeek a publié sa quatrième génération de modèles, en gardant temporairement en vie les anciens noms sous forme d'alias, pour laisser aux équipes le temps de s'adapter. Cette fenêtre de 90 jours se referme aujourd'hui.

Concrètement, les anciens identifiants pointaient déjà vers les nouveaux modèles depuis avril, sans que personne n'ait rien à faire. Autrement dit, vous utilisez probablement déjà la version 4 sans le savoir. Ce qui disparaît, ce n'est pas le modèle, c'est le nom. Et un nom qui n'existe plus dans une configuration de production, c'est une chaîne entière qui s'arrête : pipeline automatisé, agent, rapport programmé, tâche de fond.

La correspondance à retenir est simple. L'ancien deepseek-chat devient deepseek-v4-flash. L'ancien deepseek-reasoner devient le même deepseek-v4-flash, mais avec le mode réflexion activé. L'adresse de l'API, la clé et la structure des requêtes ne changent pas.

Le piège qui va coûter cher à certains 🪤
Regardez bien la deuxième correspondance. L'ancien modèle de raisonnement pointe vers la version Flash, la plus rapide et économique, pas vers la version Pro. Si vous utilisiez cet identifiant précisément pour la qualité de son raisonnement, vous risquez une dégradation silencieuse de vos résultats : le code fonctionnera, mais les réponses seront moins bonnes. La parade consiste à tester vos sorties après migration, et à basculer vers deepseek-v4-pro avec la réflexion activée si la qualité chute. Une panne se voit tout de suite, une dégradation se découvre trois semaines plus tard.

Autre subtilité qui touche au portefeuille : le mode réflexion n'est plus déterminé par le choix du modèle, il est devenu un paramètre de la requête. Si vous utilisiez l'ancien identifiant de discussion pour des tâches simples et volumineuses, pensez à désactiver explicitement la réflexion après migration. Sinon vous paierez des tokens de raisonnement dont vous n'avez pas besoin, ce mécanisme que nous avons détaillé dans notre article sur les modèles de raisonnement.

Les deux modèles, pour choisir juste

Modèle Paramètres À utiliser pour
deepseek-v4-flash 284 milliards au total, 13 milliards actifs Le volume, la vitesse, le coût réduit
deepseek-v4-pro 1 600 milliards au total, 49 milliards actifs Les tâches exigeantes, le raisonnement de qualité

Les deux sont publiés sous licence MIT avec des poids ouverts, et disposent d'une fenêtre de contexte d'un million de tokens. La version Flash est facturée environ 0,87 dollar par million de tokens en sortie, un tarif qui reste inférieur de 60 à 90% à celui des modèles de pointe américains comparables.

Ce que cette échéance révèle

Au-delà de l'aspect pratique, cette migration en dit long sur un basculement. Selon une analyse relayée récemment, les modèles chinois représenteraient désormais entre 30 et 46% des tokens consommés par les entreprises via les grandes plateformes de développement américaines. Une simple opération de maintenance chez un fournisseur chinois est aujourd'hui capable de casser des systèmes de production partout dans le monde.

C'est une illustration très concrète de la dépendance dont nous parlions dans notre article sur les modèles ouverts. Ironie de la situation : DeepSeek publie ses poids sous licence libre, ce qui signifie que rien n'oblige à passer par son API. Ceux qui hébergent le modèle eux-mêmes ne sont tout simplement pas concernés par l'échéance d'aujourd'hui. Utiliser un modèle ouvert via l'API de son créateur, c'est profiter de la commodité tout en gardant la dépendance. La liberté existe, encore faut-il l'exercer.

Si vous avez du code en production, la vérification prend cinq minutes : cherchez les deux anciens identifiants dans votre base de code, vos configurations de passerelle et vos fichiers d'infrastructure. Cinq minutes aujourd'hui valent mieux qu'une astreinte ce soir.

Espace publicitaire