DeepSeek
DeepSeek publie les poids de V4-Pro et V4-Flash sous licence MIT. Les deux variantes annoncent un contexte de 1M ; la fiche distingue leurs caractéristiques documentées, les benchmarks de l'éditeur et le prix du service API.
En bref
DeepSeek V4 regroupe deux modèles dont les poids sont publiés sous licence MIT : V4-Pro, une architecture MoE de 1,6 billion de paramètres dont 49 milliards actifs, et V4-Flash, 284 milliards dont 13 milliards actifs. Les deux annoncent un contexte 1M. Le score de 80,6 % sur SWE-bench Verified et les comparaisons aux concurrents sont des résultats publiés par DeepSeek, pas une mesure indépendante de Monsieur Prompt.
01 C'est quoi
Un modèle ouvert de raisonnement et de code, en deux tailles. La force : la licence MIT et un prix par token très bas.
V4-Pro
MoE de 1,6 billion de paramètres (49 Md actifs). Raisonnement, code et agentique, contexte 1M.
V4-Flash
284 Md de paramètres (13 Md actifs). Rapide et économique, contexte 1M.
Poids sous licence MIT
V4-Pro et V4-Flash sont téléchargeables depuis les dépôts officiels et peuvent être auto-hébergés.
La carte officielle attribue 80,6 % sur SWE-bench Verified à la configuration DeepSeek V4-Pro-Max. Il s'agit d'un résultat de l'éditeur pour une configuration précise, pas d'une mesure indépendante de Monsieur Prompt ni d'une comparaison strictement contrôlée avec les services concurrents.
02 Comment ça marche
Le prix affiché de DeepSeek n'est pas son prix réel. Tout dépend d'un cache dont l'écart dépasse l'entendement.
- Un cache touché coûte cent vingt fois moins qu'un cache manqué. Sur V4-Pro, un million de tokens en entrée coûte 0,435 dollar si le cache est manqué, et 0,003625 dollar s'il est touché. Sur V4-Flash, 0,14 contre 0,0028, soit cinquante fois moins. Aucun autre acteur du lot n'affiche un tel écart : c'est la mécanique qui décide de ta facture.
- Le contexte long est traité autrement. DeepSeek combine deux mécanismes d'attention, l'un compressé et creux, l'autre fortement compressé. Le résultat annoncé est net : sur un contexte d'un million de tokens, V4-Pro ne demande que 27 % des opérations par token et 10 % du cache mémoire de la génération précédente. Le long contexte n'est pas seulement possible, il est rendu abordable.
- Le modèle n'active qu'une fraction de lui-même. V4-Pro compte 1,6 billion de paramètres mais n'en active que 49 milliards par token. V4-Flash, 284 milliards pour 13 milliards actifs. C'est ce qui permet à un modèle de cette taille d'être servi à ce prix.
- La réflexion est activée par défaut. Les deux modèles acceptent un mode avec et un mode sans réflexion, ce dernier n'étant pas le comportement par défaut.
- Il parle deux langues d'API. DeepSeek expose une adresse au format OpenAI et une autre au format Anthropic. Concrètement, un outil écrit pour l'un ou l'autre écosystème peut pointer vers DeepSeek sans être réécrit.
- Ton solde offert part en premier. La dépense se calcule en multipliant les tokens par le prix, et se déduit en priorité du crédit offert avant de toucher au crédit rechargé.
Une échéance proche à ne pas manquer : les identifiants deepseek-chat et deepseek-reasoner sont annoncés comme dépréciés au 24 juillet 2026 à 15 h 59 UTC. Ils correspondent aux modes sans réflexion et avec réflexion de V4-Flash. Tout code qui les appelle doit basculer sur deepseek-v4-flash ou deepseek-v4-pro.
03 Ce que ça sait faire
Ce qu'annonce DeepSeek, présenté honnêtement.
✓ Ce qui est fort
- ✓Poids publiés sous licence MIT : téléchargeables et auto-hébergeables.
- ✓Très bon marché : V4 Flash 0,14 $/0,28 $, V4 Pro 0,435 $/0,87 $ (cache-hit 0,003625 $).
- ✓Score éditeur en code : 80,6 % sur SWE-bench Verified pour V4-Pro-Max, configuration à conserver lors de toute citation.
- ✓Contexte 1M sur V4-Pro comme sur V4-Flash.
04 Ce que ça ne sait pas faire
Les contraintes réelles, et ce que le prix bas ne dit pas.
- Auto-héberger 1,6 billion de paramètres n'est pas à ta portée. La licence MIT te donne le droit de télécharger les poids, pas les machines pour les faire tourner. Sur V4-Pro, la liberté est théorique pour à peu près tout le monde. V4-Flash, à 284 milliards, reste lui aussi hors d'atteinte d'un poste de travail.
- Le prix bas suppose que le cache travaille. Sans réutilisation de contexte, tu paies le tarif cache manqué, cent vingt fois supérieur sur V4-Pro. L'économie annoncée n'est pas automatique, elle dépend de la forme de ta charge de travail.
- La sortie plafonne à 384 000 tokens. C'est généreux, mais c'est un plafond par appel, distinct du contexte d'un million.
- V4-Pro est bridé en concurrence. Sa limite est annoncée à 500 requêtes simultanées, contre 2 500 pour V4-Flash. Le modèle le plus capable est aussi le plus contraint en parallélisme.
- Les benchmarks cités viennent de l'éditeur. Les scores publiés, dont 93,5 sur LiveCodeBench et 3206 en Codeforces, sont ceux de DeepSeek pour la configuration V4-Pro-Max, son mode d'effort de raisonnement maximal. Ce ne sont pas des mesures indépendantes, et la configuration doit être citée avec le score.
- V4 est annoncé comme une préversion. La carte officielle parle d'une version preview de la série.
05 Les versions
Deux modèles, une seule licence, et un rapport de prix de trois pour un.
- DeepSeek-V4-Pro
- 1,6 billion de paramètres, 49 milliards actifs, contexte d'un million de tokens, sortie jusqu'à 384 000. API : 0,435 $ en entrée cache manqué, 0,003625 $ cache touché, 0,87 $ en sortie. Limite de 500 requêtes simultanées.
- DeepSeek-V4-Flash
- 284 milliards de paramètres, 13 milliards actifs, mêmes contexte et sortie. API : 0,14 $ cache manqué, 0,0028 $ cache touché, 0,28 $ en sortie. Limite de 2 500 requêtes simultanées, soit cinq fois celle de Pro.
- V4-Pro-Max
- Le mode d'effort de raisonnement maximal de V4-Pro. C'est la configuration à laquelle se rapportent les scores publiés par DeepSeek.
- Les poids
- Les deux modèles sont publiés sous licence MIT, simple et sans restriction ajoutée. Des versions Base existent aussi, en précision FP8 mixte.
- Identifiants API
deepseek-v4-proetdeepseek-v4-flash. Les anciens aliasdeepseek-chatetdeepseek-reasonerdisparaissent le 24 juillet 2026.
06 Prix & accès
Un modèle ouvert et auto-hébergeable, plus un tarif API par million de tokens parmi les plus bas.
Tarifs en date de juillet 2026. Les prix, offres et quotas affichés correspondent à l'état documenté à cette date. Ils peuvent évoluer ; consulte la source officielle citée sur la page avant achat.
- Poids ouverts · licence MIT
- V4-Pro et V4-Flash sont téléchargeables et auto-hébergeables ; l'infrastructure nécessaire reste importante.
- API · V4 Pro
- 0,435 $/0,87 $ par M de tokens, cache-hit à 0,003625 $.
- API · V4 Flash
- 0,14 $/0,28 $ par M de tokens, rapide et économique.
- Identifiants API
deepseek-v4-proetdeepseek-v4-flash; les anciens alias sont annoncés comme retirés le 24 juillet 2026.
Tarifs vérifiés le 14 juillet 2026 sur la grille officielle détaillée. Les anciens identifiants deepseek-chat et deepseek-reasoner sont annoncés comme retirés le 24 juillet 2026.
07 Quand le choisir
DeepSeek brille quand tu veux un modèle ouvert de raisonnement à bas coût. Voici les cas où il gagne.
- Tu veux un modèle ouvert de raisonnement et de code, auto-hébergeable.
- Tu cherches un prix API bas et acceptes de valider la qualité sur tes propres tâches.
- Tu vises le code : DeepSeek publie 80,6 % sur SWE-bench Verified pour V4-Pro-Max, sans mesure indépendante de Monsieur Prompt.
- Tu as besoin d'un contexte 1M pour de longs documents ou de gros dépôts.
- V4-Flash pour la vitesse et l'économie, V4-Pro pour la capacité.
08 Alternatives
Aucun modèle n'est le meilleur partout. Le bon choix dépend de ton budget et de ta tâche.
Mistral
Modèle ouvert souverain et européen, avec l'assistant Vibe (ex-Le Chat) et un coût maîtrisé.
Actualité en temps réelGrok
Le modèle de xAI, connecté au flux de X. Pour réagir à l'actualité, le code et le STEM.
Côté GoogleGemini
L'assistant et la famille de modèles de Google, avec un contexte 1M sur 3.1 Pro.
09 Verdict
DeepSeek publie sous MIT, la licence la plus permissive du lot, sans seuil d'utilisateurs ni obligation de nommage. C'est son vrai différenciateur, plus encore que son prix. Encore faut-il lire ce prix correctement : sur V4-Pro, un cache touché coûte cent vingt fois moins qu'un cache manqué. L'économie n'est donc pas donnée, elle dépend de la réutilisation de ton contexte. Et la liberté que confère la licence reste largement théorique : faire tourner 1,6 billion de paramètres chez soi n'est à la portée de presque personne. Les scores publiés sont ceux de l'éditeur, pour la configuration V4-Pro-Max.
- Poids sous licence MIT et auto-hébergement possible : le principal différenciateur.
- Code au sommet des ouverts, prix par token très bas.
- À anticiper : V4 est annoncé en preview, et le prix bas suppose que le cache travaille.
10 Questions fréquentes
DeepSeek, c'est quoi ?
DeepSeek V4 est une famille de modèles dont les poids V4-Pro et V4-Flash sont publiés sous licence MIT. V4-Pro compte 1,6 billion de paramètres, dont 49 milliards actifs ; V4-Flash, 284 milliards, dont 13 milliards actifs. Les deux annoncent un contexte de 1M.
Combien coûte DeepSeek ?
Dans l'API officielle, V4-Pro coûte 0,435 $ en entrée hors cache et 0,87 $ en sortie par million de tokens. V4-Flash coûte 0,14 $ en entrée et 0,28 $ en sortie. L'auto-hébergement des poids MIT n'a pas de redevance de modèle, mais implique ses propres coûts d'infrastructure. Tarifs en date de juillet 2026.
DeepSeek est-il open source ?
Les poids et fichiers des modèles DeepSeek V4-Pro et V4-Flash sont téléchargeables depuis le compte officiel DeepSeek et portent une licence MIT. Cela permet l'auto-hébergement, mais ne signifie pas que les données d'entraînement ou tout le service API sont ouverts.
DeepSeek ou Mistral ?
DeepSeek pour un modèle ouvert de raisonnement et de code sous licence MIT, très bon marché et auto-hébergeable, avec un contexte 1M. Mistral pour un modèle ouvert souverain et européen, avec l'assistant Vibe et un coût maîtrisé. Attention à la nuance de licence : DeepSeek publie sous MIT simple, Mistral sous une MIT modifiée.
Sources primaires consultées le 14 juillet 2026 : annonce V4, modèles et prix API, carte officielle V4-Pro et licence V4-Flash.
Choisis le bon modèle ouvert
Compare DeepSeek aux autres modèles ouverts et aux assistants du marché, ou parcours tous les LLM.