Connexion
Mis à jour le
Sur cette page
Choisir son IA

Choisir un modèle avec sa tête.

Une grille à quatre critères pour décider sans suivre le top du jour LinkedIn.

⏱ 6 min de lecture🎯 4 critères à interroger⚡ x3 à x10 léger vs Thinking
ChatGPTClaudeGeminiVibe

Chaque éditeur propose plusieurs modèles. Le marketing pousse en permanence le plus puissant, alors qu'un modèle léger règle 70 % des tâches courantes. Cette leçon vous redonne le contrôle.

Promesse

À la fin de cette leçon

Vous saurez choisir un modèle IA en raisonnant sur quatre critères : juridiction, capacité de raisonnement, capacité agentique, coût Wh par requête.

Pourquoi maintenant

Les modèles se multiplient

Chaque éditeur en propose plusieurs au sein de son offre : ChatGPT décline GPT-5.6 Sol, Terra et Luna, Anthropic empile Fable, Opus, Sonnet et Haiku, Google maintient Gemini Pro et Flash, Mistral aligne Large, Medium et Small. Hors du quartet, des challengers montent, Grok (xAI) côté américain, DeepSeek côté chinois, et la même grille s'applique à eux, juridiction en tête. Le marketing IA pousse en permanence le modèle le plus puissant, alors qu'un modèle léger suffit pour 70 % des tâches courantes.

Depuis juillet 2026, une difficulté s'ajoute : le haut de gamme n'est plus compris dans tous les plans. Claude Fable 5, qu'Anthropic présente comme son modèle le plus capable, n'est inclus que dans Max et Team Premium, plafonné à 50 % des limites hebdomadaires, il se paie au crédit sur le plan Pro, et il est absent du plan gratuit. Le meilleur modèle sur le papier n'est pas forcément celui auquel votre abonnement donne accès.

Choisir « par défaut » est devenu un risque : risque de surcoût, risque énergétique, risque juridictionnel quand vous envoyez machinalement vos données vers un modèle américain. La grille de décision que voici vous redonne le contrôle.

Le concept central

Une grille à quatre critères

Quatre questions à poser, dans cet ordre. La séquence compte : la juridiction se vérifie avant la performance, le coût Wh se calcule à la fin.

  1. Juridiction

    Où vivent vos données pendant et après la requête ? Critique pour RH, juridique, santé, stratégique.

  2. Raisonnement

    Chaîne logique, calcul, analyse étape par étape ? Ou simple reformulation ?

  3. Agentique

    Exécuter une suite d'actions de bout en bout ? Ou répondre une fois ?

  4. Coût Wh

    Un Thinking consomme 3 à 10 fois plus qu'un modèle léger. Vraiment besoin du max ?

Panorama 2026

Quatre flagships à mettre en grille

Les modèles flagship 2026 ont chacun un profil dominant sur la grille. Lire de gauche à droite pour cadrer votre choix selon l'usage.

GPT-5.6

OpenAI · ChatGPT · USA

Modèle Sol Pro, mode agent, 400k tokens en Pro
Polyvalent agentique

Claude Opus 5

Anthropic · USA · opt-out API

Modèle Adaptive thinking, Computer Use
Code & rédaction

Gemini 3.1 Pro

Google · USA · EU activable

Modèle Reasoning, 1M tokens, recherche live
Recherche & corpus

Mistral Medium 3.5

Mistral AI · Vibe · France

Modèle Mode Work async, 256k tokens
Souverain RGPD

Hors du quartet

La grille tient-elle face aux challengers ?

Le quartet n'est pas le marché. Sur OpenRouter, la plateforme qui répartit les requêtes entre fournisseurs, les modèles chinois sont passés de moins de 2 % du trafic fin 2024 à environ 51 % en avril 2026, pendant que la part des modèles américains tombait de 70 % à 30 % en un an. DeepSeek, Qwen et Kimi ne sont plus des curiosités, et Grok occupe une place comparable côté américain.

La bonne nouvelle est que la grille ne change pas. Elle se contente de donner des réponses différentes.

Ce que la grille répond pour eux

Juridiction. C'est le critère qui tranche le plus vite. Passer par le service en ligne d'un éditeur chinois place vos données hors de l'espace européen, sous un droit qui n'est pas le vôtre. Pour une note RH ou un contrat, la question est réglée avant même de regarder les performances.

Raisonnement et agentique. C'est là que ces modèles se sont rapprochés le plus vite, en particulier sur le code et les tâches à étapes. Sur un usage sans données sensibles, un brainstorming ou un exercice de style, l'écart avec le quartet ne justifie plus grand-chose.

Coût. C'est leur argument principal, et il est réel. À qualité comparable sur des tâches courantes, la facture est souvent divisée par plusieurs.

Une différence structurelle mérite d'être connue : la plupart de ces modèles sont publiés en poids ouverts. Vous pouvez les héberger vous-même, sur votre infrastructure ou celle d'un prestataire européen. La juridiction redevient alors la vôtre, et le premier critère de la grille cesse d'être bloquant. Dans le quartet, seul Mistral le permet : Mistral Large 3 et la gamme Small sont publiés en poids ouverts sous licence Apache 2.0, et Mistral Medium 3.5 sous une licence MIT modifiée. OpenAI, Anthropic et Google ne proposent pas leurs modèles phares en auto-hébergement.

C'est l'arbitrage à retenir : en service hébergé, la juridiction les écarte des usages sensibles. En auto-hébergement, ils deviennent la seule option qui combine coût bas et maîtrise complète, au prix d'une compétence technique que peu d'organisations ont en interne.

Méthode appliquée

Trois cas, trois choix

Cas 1. Note interne confidentielle (RH). Vous préparez un mémo sur une réorganisation. Données très sensibles. Juridiction : France ou USA sans training. Choix : Vibe (souveraineté, en plan payant) ou Claude (politique opt-out training documentée sur l'API). ChatGPT et Gemini passent en seconde ligne sauf à activer les modes entreprise dédiés.

Cas 2. Recherche fact-checkée pour un article. Vous devez vérifier des chiffres récents et croiser des sources web. Choix : Gemini 3.1 Pro avec recherche live native, ou ChatGPT en mode recherche. Le critère est ici la fraîcheur des données, pas la souveraineté.

Cas 3. Brainstorm créatif sans enjeu factuel. Vous cherchez 10 idées de titres pour un atelier. Données triviales. Optimisez sur le coût Wh : Haiku (Anthropic), Mistral Small ou Gemini Flash suffisent largement. Sortir Opus 5 pour ça serait du gâchis énergétique et budgétaire.

Exemple concret

Cadre RH, grille appliquée

Un cadre RH prépare un mémo confidentiel sur une réorganisation impliquant 40 postes. Données ultra-sensibles. Application de la grille :

1. Tâche. Rédaction structurée + relecture juridique. Pas d'agentique.
2. Juridiction. France ou USA sans training. Vibe ou Claude.
3. Capacités. Pas de besoin de fenêtre 1M ni de recherche live. Une fenêtre modeste suffit.
4. Coût Wh. Modèle moyen suffit. Mistral Medium ou Claude Sonnet, pas Opus.

💡

Choix final : Vibe (Mistral Medium 3.5) en plan payant, juridiction française, fenêtre 256k, opt-out d'entraînement par défaut, coût Wh raisonnable. Pas ChatGPT par défaut. La décision tient en deux minutes une fois la grille intégrée.

À éviter

Les pièges courants

Optimiser sur la « puissance »

Sortir Opus 5 ou GPT-5.6 Sol pour reformuler un email, c'est mettre un GPU de 700 watts sur une tâche qu'un modèle léger règle en deux secondes. Pure inflation.

Ignorer la juridiction par flemme

Envoyer une note RH à ChatGPT par habitude, alors que Vibe ou Claude couvriraient le cas, c'est créer une exposition juridique inutile.

Confondre raisonnement et agentique

Un modèle qui raisonne longuement (Thinking) n'est pas forcément agentique. Un modèle agentique exécute des actions externes (clic, scraping, posting). Deux capacités différentes.

Quiz de validation

Quiz de validation

8 questions. 60 % de bonnes réponses pour valider la leçon.

1Selon la grille de décision à 4 critères, quel critère faut-il vérifier en premier pour des données professionnelles sensibles ?
2Pour un brainstorm créatif sans enjeu factuel (10 titres d'atelier), quel choix de modèle est le plus aligné avec la grille ?
3Quelle différence sépare la capacité de raisonnement et la capacité agentique ?
4Pour une recherche fact-checkée avec sources web fraîches, quel modèle est le plus adapté en 2026 ?
5Cochez les 4 critères de la grille de décision pour choisir un modèle IA.(plusieurs réponses)
6Cochez les pièges courants quand on choisit un modèle IA.(plusieurs réponses)
7Un modèle léger comme Haiku, Mistral Small ou Gemini Flash suffit pour une majorité des tâches courantes en entreprise.
8Pour une note RH confidentielle, ChatGPT est le bon choix par défaut en 2026.

Synthèse

À retenir

Cinq points pour ancrer la leçon

Quatre critères, dans cet ordre. Juridiction, raisonnement, agentique, Wh. Pas un de moins.
Le meilleur modèle dépend du cas. Pas de classement absolu, un classement par usage.
Modèle léger pour tâches simples. Haiku, Flash, Mistral Small couvrent 70 % des besoins quotidiens.
Juridiction avant performance. Vibe ou Claude passent devant ChatGPT et Gemini sur données sensibles, à condition de vérifier le réglage d'entraînement : plan payant chez Vibe, désactivation explicite chez Claude, ou API et Claude for Work qui en sont exclus d'office.
Raisonnement ≠ agentique. Un Thinking long n'est pas un agent autonome. Deux capacités à ne pas mélanger.

Mise en pratique

5 à 10 minutes pour auditer

Reprenez vos trois dernières requêtes IA professionnelles. Pour chacune, appliquez la grille à 4 critères. Notez si votre choix de modèle de l'époque tient toujours, ou si vous auriez fait mieux avec un autre.

Critère de réussite : vous identifiez au moins une requête où vous avez sur-dimensionné le modèle, et une où vous auriez dû changer de juridiction.

Questions fréquentes

Quel est le meilleur modèle IA en 2026 ?

La question n'a pas de réponse absolue, seulement une réponse par cas d'usage. Quatre critères la tranchent, dans cet ordre : où vivent vos données, la tâche demande-t-elle du raisonnement, faut-il exécuter des actions, et quel est le coût énergétique acceptable. Un classement général change tous les mois, cette grille non.

Faut-il toujours prendre le modèle le plus puissant ?

Non, et c'est l'erreur la plus coûteuse. Un modèle léger comme Haiku, Gemini Flash ou Mistral Small couvre l'essentiel des tâches quotidiennes. Sortir un modèle de raisonnement pour reformuler un email consomme jusqu'à dix fois plus pour un résultat équivalent.

Un modèle qui raisonne longtemps est-il un agent autonome ?

Non, ce sont deux capacités distinctes. Un modèle de raisonnement décompose un problème avant de répondre, mais il répond. Un modèle agentique exécute des actions à l'extérieur : naviguer, cliquer, écrire dans un outil. Un modèle peut avoir l'une sans l'autre.

Comment savoir si j'ai sur-dimensionné mon modèle ?

Reprenez vos dernières requêtes et demandez-vous, pour chacune, si un modèle léger aurait donné un résultat équivalent. Reformulation, traduction, résumé court et brainstorming n'ont besoin ni de raisonnement étendu ni de grande fenêtre de contexte. Si la réponse vous convenait du premier coup, le modèle était probablement trop gros.

Faut-il changer de modèle quand un nouveau sort ?

Pas par réflexe. Un nouveau modèle ne déplace votre grille que s'il change une des quatre réponses : juridiction, capacité de raisonnement, capacité agentique, coût. Sur la majorité des tâches courantes, un modèle léger d'il y a six mois fait le même travail que le dernier annoncé. Testez sur vos propres cas avant de basculer.