Aller au contenu
Mastering Claude

Accueil / Ce qu'est un modèle de langue, sans jargon

Ce qu'est un modèle de langue, sans jargon7 minFondation

Une famille de modèles, un choix de vitesse contre profondeur

Les modèles d'une même famille partagent le même entraînement de base et ne diffèrent vraiment que par le compromis entre la vitesse de la réponse et la profondeur du raisonnement appliqué avant de répondre.

Claude existe sous quatre modèles distincts au moment d'écrire ces lignes, Fable 5.1, Opus 5, Sonnet 5 et Haiku 4.5. Les quatre sortent du même entraînement de base et se distinguent surtout par un seul réglage, le compromis entre la vitesse de la réponse et la profondeur du raisonnement appliqué avant de répondre.

Un socle commun, un curseur différent

Choisir un modèle revient à déplacer un curseur, pas à changer d'outil. À une extrémité, un modèle répond en quelques secondes et convient à des tâches courtes et répétées, un accusé de réception, une reformulation, un tri de messages. À l'autre extrémité, un modèle prend plus de temps parce qu'il enchaîne davantage d'étapes de raisonnement avant de conclure, ce qui compte pour un dossier à recouper ou un plan à vérifier sur plusieurs points. La documentation publiée par Anthropic recommande de commencer par Opus 5 pour la plupart des usages, et de réserver Fable 5.1 aux tâches qui demandent un raisonnement exigeant ou qui s'étirent sur de nombreuses étapes enchaînées.

Un exemple concret aide à sentir la différence. Voici deux demandes qu'un même bénévole pourrait poser dans la même journée.

Demande courte : reformule ce message d'accueil en trois phrases plus chaleureuses.
Demande longue : compare les douze devis reçus ce trimestre, signale les écarts de
prix les plus marqués et propose un classement argumenté.

La première tâche se traite en quelques secondes par un modèle rapide. La seconde gagne à être confiée à un modèle qui prend le temps de recouper les chiffres avant de conclure.

Le tarif suit le même compromis

Le prix facturé pour chaque million de mots échangés varie fortement d'un modèle à l'autre, et cette variation suit exactement le même axe que la vitesse, le modèle le plus profond coûte le plus cher, le plus rapide coûte le moins cher. La figure ci dessous reprend ces quatre tarifs tels que publiés, avec leur source et leur date, plutôt que de les recopier ici où ils se périmeraient sans que personne ne le remarque.

Retenir les noms exacts importe moins que retenir le principe : un modèle plus profond n'est pas un modèle qui répond mieux à toutes les demandes, c'est un modèle qui répond mieux à celles qui ont besoin de plusieurs étapes de raisonnement. Le choix du modèle, traité ici, agit sur un premier levier. La leçon suivante en montre un second, indépendant de celui-ci : l'ordre des mots à l'intérieur d'un même message.

Figure 1

Le tarif d'entrée par million de mots échangés, par modèle

10$ / million, entrée
Fable 5.1, le niveau le plus profond, réservé à un raisonnement exigeant ou à une tâche qui s'étire sur de nombreuses étapes
platform.claude.com, aperçu des modèles, 2026-09-02
5$ / million, entrée
Opus 5, le niveau conseillé par défaut pour la plupart des tâches courantes
platform.claude.com, aperçu des modèles, 2026-09-02
2$ / million, entrée
Sonnet 5, présenté comme le meilleur équilibre entre vitesse et intelligence
platform.claude.com, aperçu des modèles, 2026-09-02
1$ / million, entrée
Haiku 4.5, le niveau le plus rapide de la famille, pour des réponses immédiates
platform.claude.com, aperçu des modèles, 2026-09-02
Le prix facturé pour un million de mots envoyés varie du simple au décuple selon le modèle retenu, un signal concret du compromis entre vitesse et profondeur décrit dans le corps.
Figure 2

Le tarif d’entrée des quatre modèles, comparé

Fable 5.1
10 $ / million, entrée
Opus 5
5 $ / million, entrée
Sonnet 5
2 $ / million, entrée
Haiku 4.5
1 $ / million, entrée
platform.claude.com, aperçu des modèles, 2026-09-02
Les barres montrent le rapport de un à dix entre le niveau le plus profond et le plus rapide, là où la liste de valeurs le laissait déduire.
Calibrez vous-même

Une bénévole d'une association configure son assistant conversationnel avec le modèle le plus rapide de la gamme pour préparer, en quelques secondes chacune, les réponses courtes envoyées chaque matin aux demandes d'adhésion reçues par la messagerie de l'association.

Écrivez en une phrase ce que cette situation établit, et en une phrase ce qu'elle n'établit pas.

Ce qu’il faut retenir
  • Les quatre modèles Claude actuels partagent le même entraînement de base et ne se distinguent vraiment que par un compromis entre vitesse de réponse et profondeur de raisonnement.
  • Un modèle plus profond ne traite pas mieux une tâche courte, il met simplement plus de temps à revenir sur une question qui n'en avait pas besoin.
  • La documentation publiée par Anthropic recommande de commencer par Opus 5 pour la plupart des tâches et de réserver le modèle le plus profond aux raisonnements longs.
  • Le tarif facturé par million de mots échangés suit le même axe que la vitesse, et il se périme vite, ce qui justifie de le vérifier dans la figure datée plutôt que de mémoriser un chiffre.
À faire maintenant

Notez sur une feuille trois tâches que vous confiez régulièrement à votre assistant, puis classez chacune sous vitesse ou sous profondeur en vous appuyant sur la description publique de chaque modèle avant de changer vos réglages.

Ce qui reste à vérifier

Ces points dépendent d’une interface ou d’une règle qui peut avoir changé depuis la rédaction. Vérifiez-les sur votre propre écran avant de vous y fier.

  • Le tarif exact et les noms des modèles peuvent changer, ouvrez la page Models overview citée en référence pour voir la version en vigueur au moment de votre lecture.
Vérifier à la source

Chaque affirmation datable de cette leçon renvoie ici au texte public qui la porte. Une source qui ne s’ouvre pas ne prouve rien.