Monsieur Prompt
Catégorie · LLM / IA de chat

IA de chat et LLM

Ce hub situe les familles de modèles et assistants documentés par Monsieur Prompt. Il ne constitue pas un classement : chaque fiche cite ses sources officielles, et les prix, versions et benchmarks doivent être lus avec leurs sources dans chaque fiche.

En bref

Choisis d'abord entre assistant hébergé, API et poids à déployer. Ensuite seulement, compare la disponibilité, le prix par unité, le contexte et les limites. Les comparatifs résument ces arbitrages sans transformer les annonces des éditeurs en mesures indépendantes.

01 Les modèles Claude

L'application Claude et plusieurs modèles, chacun pour un usage précis. Pas sûr ? Le comparatif Claude tranche.

L'application

L'application d'Anthropic qui donne accès aux modèles Claude par abonnement : Free à 0 €, Pro à 18 €/mois avec Claude Code inclus, Max à 90 ou 180 €/mois. Prix vérifiés en juillet 2026.

À examiner pour : utiliser Claude au quotidien par abonnement plutôt que par l'API au token.

Lire la fiche →

Nouvelles fiches vérifiées

Ajouts vérifiés à leurs sources officielles le 20 juillet 2026.

IA locale et modèles ouverts

Un guide pour choisir séparément le modèle, le moteur, l’interface et les workflows.

Toutes Les 20 fiches de cet univers

Chaque fiche détaille les capacités, les limites, l’accès et les sources officielles.

Claude Sonnet 5

Découvrez Claude Sonnet 5 : positionnement, usages, modes d’accès, capacités, limites, coûts documentés et sources vérifiées à date affichée.

Claude Opus 4.8

Analysez Claude Opus 4.8 : tâches adaptées, fonctionnement, modes d’accès, limites, coûts documentés et alternatives selon le niveau de besoin.

Claude Fable 5

Comprenez Claude Fable 5 : positionnement, travail sur le code, accès, capacités, limites, cas d’usage et sources vérifiées à date affichée.

Claude Mythos 5

Faites le point sur Claude Mythos 5 : statut d’accès, informations publiques, limites de vérification et solution disponible à privilégier selon le besoin.

GPT-5.6 Sol

Explorez GPT-5.6 Sol : positionnement, tâches adaptées, surfaces d’accès, capacités, limites et résultats attribués aux sources qui les publient.

GPT-5.6 Terra

Situez GPT-5.6 Terra dans sa famille : usages, modes d’accès, capacités, limites, coûts documentés et différences avec les autres variantes.

GPT-5.6 Luna

Découvrez GPT-5.6 Luna : positionnement rapide, cas d’usage, surfaces d’accès, limites et différences documentées avec les modèles plus avancés.

GPT-5.5

Comprenez GPT-5.5 d’OpenAI : son contexte de 1,05 million de tokens, son efficacité en tokens, la variante Pro, les prix par palier et les limites.

ChatGPT

Comprenez ChatGPT : usages conversationnels et multimodaux, modes d’accès, limites, structure des offres et alternatives, avec des sources vérifiables.

Gemini

Découvrez Gemini, ses modèles et son assistant : intégrations Google, surfaces d’accès, usages, limites, offres documentées et alternatives possibles.

Mistral

Comprenez l’écosystème Mistral : assistant, modèles ouverts ou hébergés, surfaces d’accès, usages, limites et offres décrites par leurs sources.

DeepSeek

Faites le point sur DeepSeek : familles de modèles, poids disponibles, licences, accès, capacités, limites et benchmarks correctement attribués.

Grok

Découvrez Grok : surfaces d’accès, outils disponibles, usages, limites, coûts documentés et alternatives, sans confondre annonce et mesure indépendante.

Perplexity

Évaluez Perplexity pour la recherche assistée : citations, navigation, modèles, modes d’accès, limites, offres et alternatives adaptées.

Qwen

Découvrez Qwen : familles de modèles, poids et licences, surfaces d’accès, langues, capacités, limites et alternatives pour différents déploiements.

Llama

Comprenez Llama : variantes, poids téléchargeables, licence, restrictions, options de déploiement, capacités et limites à examiner.

Claude

Comprenez l'application Claude d'Anthropic : plans Free, Pro et Max, prix officiels datés, limites d'usage en fenêtres de 5 heures et offres Team.

Gemini Notebook (ex-NotebookLM)

Comprenez NotebookLM, devenu Gemini Notebook : l'assistant de recherche de Google ancré dans tes sources, ses résumés audio et vidéo, ses limites et ses prix.

Kimi K3

Découvrez Kimi K3 : modèle multimodal de Moonshot AI, contexte d’un million de tokens, accès web, code et API, prix, ouverture et limites.

Claude Opus 5

Analysez Claude Opus 5 : contexte de 1 million de tokens, raisonnement adaptatif, cinq niveaux d’effort, prix API, accès et limites.

Quotidien + long-contexte

Le palier Sonnet documenté pour le code agentique, les modifications multi-fichiers et le long contexte.

À examiner pour : le travail quotidien lorsque le palier Opus n'est pas nécessaire.

Lire la fiche →
Palier Opus

Le modèle Opus actuel pour le code agentique complexe et le travail d'entreprise, avec contexte 1M et raisonnement adaptatif.

À examiner pour : les tâches complexes lorsque Sonnet 5 ne suffit pas.

Lire la fiche →
Agentique long format

Modèle de classe Mythos rendu sûr pour tous. Une méthode publiée documente la création d'un jeu avec ce modèle ; la fiche, elle, reste de la documentation sur sources officielles.

Le mieux pour : les tâches agentiques longues et le code au niveau dépôt.

Lire la fiche →
Accès restreint
Cyber / recherche

Le même modèle que Fable 5, sans les garde-fous, réservé à des partenaires autorisés (cyberdéfense, recherche). Pas en accès général.

Le mieux pour : comprendre la classe Mythos. Sinon, prends Fable 5.

Lire la fiche →

02 Les modèles GPT-5.6 (OpenAI)

Une génération, trois paliers durables. Le comparatif Sol / Terra / Luna détaille l'arbitrage. Pas de mesure maison : specs et benchmarks publiés par les éditeurs, sources liées.

Le vaisseau amiral

Le palier Sol de la famille GPT-5.6, avec les niveaux de raisonnement et surfaces détaillés dans la fiche sourcée.

À examiner pour : les tâches longues lorsque le coût supérieur est justifié.

Lire la fiche →
Le défaut équilibré

Le palier Terra de la famille GPT-5.6, avec un tarif inférieur à Sol dans la grille OpenAI vérifiée.

À examiner pour : un compromis coût et capacité, sans supposer une performance identique à Sol.

Lire la fiche →
Rapide / volume

Le palier Luna de la famille GPT-5.6, tarifé sous Terra et Sol dans la grille OpenAI vérifiée.

À examiner pour : les tâches répétitives sensibles au coût, après test sur ton propre corpus.

Lire la fiche →

GPT-5.5

Génération précédente

Même prix que Sol, mais seul à proposer un palier Pro. OpenAI annonce qu'il consomme moins de tokens.

Le mieux pour : le palier Pro d'OpenAI, absent de la génération 5.6.

Lire la fiche GPT-5.5 →

03 ChatGPT, Gemini et autres LLM

Les assistants grand public et les alternatives à situer.

Assistant grand public

L'app d'OpenAI : chat, image (GPT Image 2), voix et agents, sur GPT-5.6. Du gratuit au plan Pro.

Le mieux pour : l'usage quotidien tout-en-un.

Lire la fiche →
Écosystème Google

Le modèle de Google, intégré à Gmail, Docs, Android et la recherche.

Le mieux pour : travailler directement dans les outils Google.

Lire la fiche →
Recherche ancrée

Ex-NotebookLM : l’assistant de recherche de Google qui ne répond que sur tes sources. Résumés audio et vidéo.

Le mieux pour : étudier et synthétiser tes propres documents.

Lire la fiche →
Open-weight français

Vibe, anciennement Le Chat, et les modèles de Mistral AI. Les licences et possibilités d'hébergement varient selon le modèle.

À examiner pour : un fournisseur français ou des poids déployables selon la licence.

Lire la fiche →
Open-source

Des modèles ouverts orientés raisonnement, exécutables sur ta propre infrastructure.

Le mieux pour : un modèle de raisonnement ouvert à coût réduit.

Lire la fiche →
Temps réel X

Le modèle de xAI, connecté au flux de X pour les sujets d'actualité.

Le mieux pour : réagir à l'actualité et aux conversations sur X.

Lire la fiche →
Recherche sourcée

Un moteur de réponse IA qui cherche le web et cite ses sources, avec bascule entre modèles (GPT, Claude).

Le mieux pour : la recherche vérifiable et la veille.

Lire la fiche →
Open-weights

Une famille de modèles d'Alibaba couvrant plusieurs tailles et usages. La licence et les capacités doivent être vérifiées variant par variant.

À examiner pour : un modèle à déployer sur sa propre infrastructure.

Lire la fiche →
Open-weight Meta

La famille de modèles à poids disponibles de Meta. Les conditions d'utilisation ne sont pas identiques à une licence open source standard.

À examiner pour : l'auto-hébergement et la personnalisation après lecture de la licence.

Lire la fiche →

04 Quel modèle pour quel besoin

Une courte liste utile doit partir de ta contrainte principale et conserver les limites visibles.

Choisir une famille de LLM selon la contrainte, les options documentées et la vérification nécessaire
ContrainteOptions à comparerBase de la ficheÀ vérifier
Assistant généraliste hébergéChatGPT, Gemini, modèles Claude, VibeNiveaux variables selon la fichePlan, région, modèle réellement servi et traitement des données
Recherche avec sources visiblesPerplexitySources officiellesQualité des citations sur ton domaine et modèle sélectionné
API sensible au coûtComparer les paliers Claude et GPT-5.6Usage documenté en méthode pour Claude ; GPT-5.6 sur sources officiellesPrix par unité, cache, sortie et région
Déploiement sur sa propre infrastructureMistral, DeepSeek, Qwen, LlamaSources officiellesLicence, poids exacts, matériel, sécurité et coût total
Tâche critique ou longueComparer le palier supérieur de chaque famillePas de benchmark indépendant Monsieur PromptÉvaluer sur un jeu de cas réel avant toute recommandation

Les performances ne sont pas déclarées comparables sans protocole commun. Les nombres et benchmarks appartiennent à leurs sources respectives ; lire le guide LLM et les fiches avant de décider.

Passe du modèle à la méthode

Tu as choisi ton IA de chat ? Apprends à écrire des prompts qui exploitent vraiment le modèle.