Accueil / Ce qu'est un modèle de langue, sans jargon
Une famille de modèles, un choix de vitesse contre profondeur
Les modèles d'une même famille partagent le même entraînement de base et ne diffèrent vraiment que par le compromis entre la vitesse de la réponse et la profondeur du raisonnement appliqué avant de répondre.
Claude existe sous quatre modèles distincts au moment d'écrire ces lignes, Fable 5.1, Opus 5, Sonnet 5 et Haiku 4.5. Les quatre sortent du même entraînement de base et se distinguent surtout par un seul réglage, le compromis entre la vitesse de la réponse et la profondeur du raisonnement appliqué avant de répondre.
Un socle commun, un curseur différent
Choisir un modèle revient à déplacer un curseur, pas à changer d'outil. À une extrémité, un modèle répond en quelques secondes et convient à des tâches courtes et répétées, un accusé de réception, une reformulation, un tri de messages. À l'autre extrémité, un modèle prend plus de temps parce qu'il enchaîne davantage d'étapes de raisonnement avant de conclure, ce qui compte pour un dossier à recouper ou un plan à vérifier sur plusieurs points. La documentation publiée par Anthropic recommande de commencer par Opus 5 pour la plupart des usages, et de réserver Fable 5.1 aux tâches qui demandent un raisonnement exigeant ou qui s'étirent sur de nombreuses étapes enchaînées.
Un exemple concret aide à sentir la différence. Voici deux demandes qu'un même bénévole pourrait poser dans la même journée.
Demande courte : reformule ce message d'accueil en trois phrases plus chaleureuses.
Demande longue : compare les douze devis reçus ce trimestre, signale les écarts de
prix les plus marqués et propose un classement argumenté.
La première tâche se traite en quelques secondes par un modèle rapide. La seconde gagne à être confiée à un modèle qui prend le temps de recouper les chiffres avant de conclure.
Le tarif suit le même compromis
Le prix facturé pour chaque million de mots échangés varie fortement d'un modèle à l'autre, et cette variation suit exactement le même axe que la vitesse, le modèle le plus profond coûte le plus cher, le plus rapide coûte le moins cher. La figure ci dessous reprend ces quatre tarifs tels que publiés, avec leur source et leur date, plutôt que de les recopier ici où ils se périmeraient sans que personne ne le remarque.
Retenir les noms exacts importe moins que retenir le principe : un modèle plus profond n'est pas un modèle qui répond mieux à toutes les demandes, c'est un modèle qui répond mieux à celles qui ont besoin de plusieurs étapes de raisonnement. Le choix du modèle, traité ici, agit sur un premier levier. La leçon suivante en montre un second, indépendant de celui-ci : l'ordre des mots à l'intérieur d'un même message.
Le tarif d'entrée par million de mots échangés, par modèle
Le tarif d’entrée des quatre modèles, comparé
Une bénévole d'une association configure son assistant conversationnel avec le modèle le plus rapide de la gamme pour préparer, en quelques secondes chacune, les réponses courtes envoyées chaque matin aux demandes d'adhésion reçues par la messagerie de l'association.
Écrivez en une phrase ce que cette situation établit, et en une phrase ce qu'elle n'établit pas.
Ce que cela établit : Ce choix associe une tâche de réponses courtes et répétées au modèle que la famille présente comme le plus rapide, ce qui correspond à l'usage pour lequel ce niveau de modèle est recommandé.
Ce que cela n’établit pas : Cela n'établit pas que ce même modèle conviendrait à une tâche qui demande un raisonnement long ou plusieurs étapes enchaînées, un usage pour lequel un modèle plus profond de la même famille est recommandé.
Les trois calibrages faux les plus courants
- Trop large Le modèle le plus rapide de la gamme convient tout aussi bien à des tâches qui demandent plusieurs étapes de raisonnement complexe.
- Trop étroit Ce choix ne permet d'affirmer rien du tout, un seul cas d'usage ne suffisant jamais à confirmer qu'un modèle correspond à sa description publique.
- À côté Ce choix garantit que les coûts d'utilisation de la messagerie associative resteront bas ce mois-ci.
- Les quatre modèles Claude actuels partagent le même entraînement de base et ne se distinguent vraiment que par un compromis entre vitesse de réponse et profondeur de raisonnement.
- Un modèle plus profond ne traite pas mieux une tâche courte, il met simplement plus de temps à revenir sur une question qui n'en avait pas besoin.
- La documentation publiée par Anthropic recommande de commencer par Opus 5 pour la plupart des tâches et de réserver le modèle le plus profond aux raisonnements longs.
- Le tarif facturé par million de mots échangés suit le même axe que la vitesse, et il se périme vite, ce qui justifie de le vérifier dans la figure datée plutôt que de mémoriser un chiffre.
Notez sur une feuille trois tâches que vous confiez régulièrement à votre assistant, puis classez chacune sous vitesse ou sous profondeur en vous appuyant sur la description publique de chaque modèle avant de changer vos réglages.
Ces points dépendent d’une interface ou d’une règle qui peut avoir changé depuis la rédaction. Vérifiez-les sur votre propre écran avant de vous y fier.
- Le tarif exact et les noms des modèles peuvent changer, ouvrez la page Models overview citée en référence pour voir la version en vigueur au moment de votre lecture.
Chaque affirmation datable de cette leçon renvoie ici au texte public qui la porte. Une source qui ne s’ouvre pas ne prouve rien.
- Models overview consultée le 2026-09-02
- Pricing consultée le 2026-09-02