Monsieur Prompt
Comparatif · LLM

Quel LLM choisir en 2026 ?

Claude, ChatGPT, Gemini, Grok, Perplexity du côté fermé ; DeepSeek, Mistral, Qwen, Llama du côté ouvert. Neuf grandes familles, un seul objectif : trouver celle qui colle à ton besoin, ton budget et ton écosystème. Voici le tableau de synthèse et le guide de décision, sur la base des specs et des prix publiés par chaque éditeur.

Vérifié le 24 juil. 2026 Mis à jour le 24 juil. 2026

La réponse courte

Pour un défaut fiable au quotidien, code compris : Claude (Sonnet 5), la famille qui produit ce site (méthode documentée). Pour le grand public tout-en-un (chat, image, voix) : ChatGPT. Pour l'écosystème Google et le long-contexte : Gemini. Pour l'actualité en temps réel : Grok. Pour la recherche sourcée : Perplexity. Pour ouvert et bon marché (auto-hébergeable) : DeepSeek, Mistral, Qwen ou Llama.

01 Le tableau

Les neuf familles côte à côte. Prix repères par million de tokens ou par mois, tels qu'annoncés par les éditeurs. Fais défiler le tableau horizontalement sur mobile.

Tarifs en date de juillet 2026. Les montants, offres et quotas comparés correspondent à l'état documenté à cette date. Ils peuvent évoluer ; consulte les sources officielles citées avant achat.

Comparaison des principaux LLM par usage, accès et prix
Critère Claude ChatGPT Gemini Grok Perplexity DeepSeek Mistral Qwen Llama
Éditeur Anthropic OpenAI Google xAI Perplexity DeepSeek Mistral AI Alibaba Meta
Type Généraliste + agentique Assistant tout-en-un Assistant + écosystème Google Connecté à X, temps réel Moteur de réponse sourcé Raisonnement + code Ouvert européen Open-weights complet Open-weight déployé
Prix repère Sonnet 5 : 3 $ / 15 $ par M Plus 23 €/mois 3.1 Pro : 2 $ / 12 $ par M 4.5 : 2 $ / 6 $ par M Pro 20 $/mois V4 Pro : 0,44 $ / 0,87 $ par M Medium 3 : 0,40 $ / 2 $ par M 3.7-Max : 1,25 $ / 3,75 $ par M Poids gratuits, auto-hébergé
Le mieux pour Quotidien + code agentique Grand public tout-en-un Long-contexte 1M, Google Actualité temps réel, STEM Recherche sourcée Code peu cher, auto-héberger Souverain, hébergeable Multilingue, auto-héberger Personnalisation, auto-héberger
Ouvert / fermé Fermé Fermé Fermé Fermé Fermé Ouvert (MIT) Ouvert Ouvert (Apache 2.0) Open-weight

Les prix et les benchmarks cités dans ce guide sont annoncés par chaque éditeur, pas mesurés par nous. Seule la famille Claude est utilisée au quotidien ici (ce site est construit avec Claude Code) ; pour les autres, on s'appuie sur les specs publiées. Les cases en vert marquent un avantage clair sur la ligne.

02 Quand choisir Claude

Trois modèles courants, trois niveaux d'usage. L'expérience publiée concerne Claude Code sur Sonnet 5 et Opus 4.8 (méthode), ainsi qu'un jeu codé avec Fable 5 (méthode). Opus 5 vient de sortir et reste à tester ici.

✓ Le mieux pour

  • Le quotidien et le code agentique : Claude Sonnet 5, contexte 1M, sortie 128k. Prix Anthropic 3 $ / 15 $ par M (intro 2 $ / 10 $ jusqu'au 31 août 2026).
  • Le travail complexe : Claude Opus 5, contexte 1M, sortie 128k et raisonnement adaptatif. Prix 5 $ / 25 $ par M.
  • L'agentique long format : Claude Fable 5 (10 $ / 50 $ par M), état de l'art annoncé par Anthropic sur le code au niveau dépôt (SWE-Bench Pro 80 %).

✕ À garder en tête

  • Famille fermée, sans palier gratuit d'API.
  • Sur Fable 5, les requêtes cyber ou biologie/chimie basculent vers Opus 4.8 (garde-fous d'Anthropic, moins de 5 % des sessions).

Lire la fiche Claude Sonnet 5 → · Comparatif des Claude →

03 Quand choisir ChatGPT

L'assistant grand public d'OpenAI, tout-en-un, propulsé par la famille GPT-5.6.

✓ Le mieux pour

  • L'usage quotidien polyvalent : chat, image (GPT Image 2), voix et agents réunis dans une seule app.
  • Des offres claires : Free 0 €, Plus 23 €/mois (GPT-5.6 Sol, Codex, deep research), Pro à partir de 103 €/mois (tarifs OpenAI).
  • Sous le capot, les paliers GPT-5.6 Sol / Terra / Luna pour l'API, avec Terra comme choix par défaut annoncé par OpenAI.

✕ À garder en tête

  • Famille fermée ; le détail des modèles et le choix du bon palier se jouent sur les fiches GPT-5.6.

Lire la fiche ChatGPT → · Comparatif GPT-5.6 →

04 Quand choisir Gemini

L'assistant et la famille de modèles de Google, intégrés à Gmail, Docs, Android et Search.

✓ Le mieux pour

  • Travailler dans l'écosystème Google : Gemini est branché sur Gmail, Docs, Android et Search.
  • Le long-contexte : Gemini 3.1 Pro, contexte 1M, 2 $ / 12 $ par M (tarifs Google) ; Gemini 3.5 Flash à 1,50 $ / 9 $.
  • Le raisonnement le plus dur avec Deep Think, sur le plan AI Ultra à 99,99 $/mois.

✕ À garder en tête

  • Famille fermée ; l'intérêt tient beaucoup à l'intégration Google, moins pertinent hors de cet écosystème.

Lire la fiche Gemini →

05 Quand choisir Grok

Le modèle de xAI, branché sur le flux de X pour coller à l'actualité.

✓ Le mieux pour

  • Réagir à l'actualité en temps réel via la connexion au flux de X.
  • Le code et le STEM : Grok 4.5 (sorti le 8 juil. 2026), classé 5e sur 152 modèles en génération et débogage de code selon xAI ; contexte 500k, vision, function calling.
  • Un prix contenu : 2 $ / 6 $ par M (tarifs xAI), plus un palier gratuit et les plans SuperGrok.

✕ À garder en tête

  • Grok 5 est annoncé mais pas encore sorti (bêta visée Q2 2026, glissante) : ne compte pas dessus aujourd'hui.

Lire la fiche Grok →

06 Quand choisir Perplexity

Un moteur de réponse qui cherche le web et cite ses sources, plutôt qu'un modèle unique.

✓ Le mieux pour

  • La recherche sourcée et vérifiable, la veille, et remplacer une partie des recherches Google.
  • Bascule entre plusieurs modèles (GPT-5, Claude Opus 4.6), génération image et vidéo, agent navigateur Comet.
  • Des offres lisibles : Free 0 $, Pro 20 $/mois, Max 200 $/mois (tarifs Perplexity).

✕ À garder en tête

  • C'est un moteur de réponse : la qualité dépend des modèles qu'il orchestre, pas d'un modèle maison.

Lire la fiche Perplexity →

07 Quand choisir DeepSeek

Un modèle ouvert de raisonnement et de code, parmi les moins chers du marché.

✓ Le mieux pour

  • Le meilleur rapport prix : V4 Pro à 0,44 $ / 0,87 $ par M, V4 Flash à 0,14 $ / 0,28 $ (tarifs DeepSeek), soit environ 10 à 13 fois moins cher par token de sortie que des modèles fermés comparables selon DeepSeek.
  • Ouvert (licence MIT), auto-hébergeable, contexte 1M.
  • Bon niveau agentique : 80,6 % sur SWE-bench Verified pour V4-Pro-Max, meilleur open-weights à égalité avec Gemini 3.1 Pro (annoncé par DeepSeek).

✕ À garder en tête

  • V4 est encore une preview (sortie open source le 24 avr. 2026) : maturité à confirmer sur la durée.

Lire la fiche DeepSeek →

08 Quand choisir Mistral

L'option ouverte et européenne, hébergeable, à coût maîtrisé. Entreprise française.

✓ Le mieux pour

  • Un modèle souverain et européen, à poids ouverts, hébergeable chez soi. Utilisé en production par ASML, HSBC, BMW, CMA CGM.
  • Un coût maîtrisé : Medium 3 (frontier) à 0,40 $ / 2 $ par M, Large à 2 $ / 6 $, Nemo à 0,02 $ / 0,03 $ (tarifs Mistral).
  • Small 4 unifie raisonnement (Magistral), vision (Pixtral) et code agentique (Devstral) en un modèle configurable.

✕ À garder en tête

  • Notre lecture repose sur les specs publiées.

Lire la fiche Mistral →

09 Quand choisir Qwen

La famille open-weights la plus complète d'Alibaba en 2026.

✓ Le mieux pour

  • Open-weights (Apache 2.0) sur texte, code, vision et raisonnement ; le flagship 235 Md MoE est ouvert.
  • Multilingue (119 langues), modes de pensée hybrides pour arbitrer perf, vitesse et coût, support MCP.
  • Top scores annoncés sur Terminal-Bench 2.0, SWE-Bench Pro et MCP-Atlas ; Qwen3.7-Max à 1,25 $ / 3,75 $ par M (promo, tarifs Alibaba).

✕ À garder en tête

  • Certaines variantes récentes (Qwen3.7-Max, Qwen3.6-Plus) restent propriétaires, en accès web ou Alibaba Cloud.

Lire la fiche Qwen →

10 Quand choisir Llama

L'écosystème open-weight le plus déployé, signé Meta.

✓ Le mieux pour

  • L'auto-hébergement et la personnalisation : c'est l'écosystème open-weight le plus répandu.
  • Llama 4 (architecture Mixture-of-Experts) : Scout tient sur un seul GPU haut de gamme avec un contexte de 10M tokens ; Maverick (17 Md de paramètres actifs sur 128 experts) était, au lancement, au-dessus de GPT-4o et Gemini 2.0 Flash sur MMLU, MATH et compréhension d'image (annoncé par Meta).

✕ À garder en tête

  • Licence open-weight de Meta : usage commercial permis, mais avec restrictions et politique d'usage acceptable (plus permissif qu'une API fermée, moins qu'Apache 2.0).
  • Behemoth est encore en preview mi-2026 : à ne pas présenter comme sorti.

Lire la fiche Llama →

11 Guide de décision

Ton besoin, la famille qui va avec.

  • Un défaut fiable au quotidien, code compris : Claude (Sonnet 5).
  • Le travail agentique complexe : Claude Opus 5, ou Gemini avec Deep Think selon l'écosystème.
  • L'agentique long format et le code au niveau dépôt : Claude Fable 5.
  • Un assistant grand public tout-en-un (chat, image, voix, agents) : ChatGPT.
  • Travailler dans Gmail, Docs et Android, avec du long-contexte 1M : Gemini.
  • Réagir à l'actualité en temps réel : Grok.
  • De la recherche sourcée et vérifiable : Perplexity.
  • Le moins cher pour du raisonnement et du code : DeepSeek.
  • Un modèle ouvert, européen, hébergeable : Mistral.
  • Le meilleur open-weights multilingue à auto-héberger : Qwen.
  • L'écosystème open-weight le plus déployé, pour personnaliser : Llama.
  • Choisir entre les trois Claude, ou entre les trois paliers GPT-5.6 : voir les comparatifs dédiés.

12 Verdict

On teste Claude au quotidien : ce site est produit et maintenu avec Claude Code, donc notre reco quotidienne penche pour Claude, Sonnet 5 par défaut. Pour tout le reste, on s'appuie sur les specs et les benchmarks publiés par chaque éditeur, qu'on attribue toujours, sans prétendre les avoir mesurés. Au fond, le bon LLM dépend d'abord de ta contrainte principale : budget, ouverture du modèle, écosystème, besoin de sources ou de temps réel. Le tableau et le guide ci-dessus sont là pour la trancher.

  • Quotidien + code : Claude.
  • Grand public tout-en-un : ChatGPT.
  • Écosystème Google : Gemini.
  • Ouvert et bon marché : DeepSeek, Mistral, Qwen, Llama.
  • Sources ou temps réel : Perplexity, Grok.

13 Questions fréquentes

Quel LLM choisir si je débute ?

Pour un usage grand public tout-en-un (chat, image, voix), ChatGPT est le plus simple, avec un palier gratuit puis Plus à 23 €/mois. Pour un défaut fiable au quotidien, y compris pour coder, Claude (Sonnet 5) est notre reco : c'est la famille qu'on utilise pour produire ce site. Les deux se prennent en main sans configuration. Tarifs en date de juillet 2026.

Quel est le LLM le moins cher ?

Côté API, DeepSeek est le plus agressif : V4 Pro à 0,44 $ / 0,87 $ par million de tokens et V4 Flash à 0,14 $ / 0,28 $ (tarifs DeepSeek). Les modèles open-weight comme Llama, Qwen ou DeepSeek peuvent aussi s'auto-héberger, ce qui déplace le coût par token vers un coût d'infrastructure. Tarifs en date de juillet 2026.

Faut-il un modèle ouvert ou fermé ?

Fermé (Claude, ChatGPT, Gemini, Grok, Perplexity) : le plus simple, pas d'infrastructure à gérer, mais tu dépends de l'éditeur. Ouvert (DeepSeek en licence MIT, Qwen en Apache 2.0 sur le flagship, Mistral, Llama en open-weight) : tu peux l'héberger, l'adapter et maîtriser le coût, au prix de la mise en place. Le choix dépend de tes contraintes de souveraineté, de budget et d'équipe.

Lequel avez-vous réellement testé ?

Claude, au quotidien : ce site a été construit et maintenu avec Claude Code sur Sonnet 5 et Opus 4.8, et un vrai jeu jouable a été codé avec Fable 5. Opus 5 vient de sortir et n'a pas encore été testé ici. Pour les autres familles, la lecture s'appuie sur les specs et les benchmarks publiés par chaque éditeur, toujours attribués.

14 Sources

Références officielles

Specs et prix annoncés par les éditeurs : Anthropic (Sonnet 5, Opus 5, Opus 4.8, catalogue Claude, Fable 5), OpenAI GPT-5.6, Google Gemini, xAI Grok, Perplexity, DeepSeek, Mistral, Qwen et Meta Llama 4. Les prix et benchmarks proviennent de ces pages, pas de mesures maison.

Descends au niveau des modèles

Une fois la famille choisie, chaque fiche donne le détail : prix, accès, forces et limites. Et pour trancher à l'intérieur d'une famille, les comparatifs dédiés sont là.