En bref
Article révisé le 6 septembre 2026 : la gamme a changé de forme pendant l’été, et le nom du modèle le plus capable n’est plus celui qu’annonçait la version précédente de cette page.
Claude est la famille de modèles de langage développée par Anthropic, laboratoire fondé en 2021 par d’anciens chercheurs d’OpenAI. De mars 2024 à l’été 2026, la gamme tenait en trois tiers nommés par puissance croissante : Haiku (léger, économique), Sonnet (équilibre coût-performance), Opus (le plus capable). Cette régularité était devenue un repère de lecture du marché — et elle vient de cesser.
Depuis le 1er septembre 2026, la gamme documentée compte quatre modèles, et le sommet ne porte plus le nom d’Opus : Haiku 4.5, Claude Sonnet 5, Claude Opus 5, et Claude Fable 5.1, placé au-dessus d’Opus pour le raisonnement exigeant et les tâches agentiques de longue haleine. Un cinquième, Claude Mythos 5.1, partage les caractéristiques de Fable 5.1 mais n’est accessible que sur invitation.
Ce qui distingue Claude de ses concurrents directs tient à deux aspects : une technique d’alignement propriétaire appelée Constitutional AI, et un positionnement marqué sur les tâches longues et autonomes — analyse de documents volumineux, workflows agentiques, contrôle d’interface. Le modèle ne génère pas d’images et n’a pas accès à internet sans outils explicites.
En clair : le menu à trois plats est devenu un menu à quatre. Haiku reste l’entrée — rapide, économique. Sonnet reste le plat principal — équilibré, bon rapport qualité-prix. Opus n’est plus le plat de chef mais le plat de référence : c’est lui qu’Anthropic recommande de choisir par défaut. Et au-dessus est apparu un plat de dégustation, Fable, deux fois plus cher et plus lent, réservé aux cas où Opus poussé à fond ne suffit pas. La leçon pratique n’est pas le nom : c’est qu’un repère de nommage stable pendant deux ans et demi peut disparaître en un été, et qu’un code qui nomme un modèle en dur vieillit plus vite qu’on ne le croit.
Fiche d’identité
| Champ | Valeur |
|---|---|
| Organisation | Anthropic (San Francisco, fondée 2021) |
| Première version | Claude 1, mars 2023 |
| Type | Modèle de langage multimodal (texte + vision) |
| Accès | API (platform.claude.com), interface claude.ai, plans Enterprise, Amazon Bedrock, Google Cloud, Microsoft Foundry |
| Fenêtre de contexte | 1 million de tokens sur Fable 5.1, Opus 5 et Sonnet 5 — 200 000 sur Haiku 4.5 |
| Gamme au 6 septembre 2026 | Haiku 4.5 · Sonnet 5 · Opus 5 · Fable 5.1 (+ Mythos 5.1 sur invitation) |
Historique
Claude 1 (mars 2023). Lancement public en deux variantes : Claude (flagship) et Claude Instant (plus rapide, moins coûteux). Positionnement déclaré : « helpful, honest, and harmless ». Disponible via API et claude.ai.
Claude 2 (juillet 2023). Améliorations en coding, mathématiques et raisonnement. La version 2.1 (novembre 2023) introduit la fenêtre contextuelle 200 000 tokens, ciblant les usages entreprise — juridique, finance, recherche documentaire.
Claude 3 (mars 2024). Première utilisation de la nomenclature Opus / Sonnet / Haiku. Introduction des capacités vision : analyse d’images, charts, documents PDF. Trois tiers de performance et de prix clairement distincts.
Claude 3.5 Sonnet (juin 2024). Modèle mid-tier qui dépasse en performance le flagship de la génération précédente. Modifie la perception des développeurs sur la sélection de modèles. La version v2 (octobre 2024) introduit Computer Use — premier modèle IA à contrôler directement une interface ordinateur.
Claude 3.7 Sonnet (février 2025). Introduction de l’extended thinking : raisonnement hybride permettant au modèle de « penser étape par étape » avant de répondre, avec un budget de tokens de réflexion configurable.
Claude 4 — Opus 4 et Sonnet 4 (mai 2025). SWE-bench Verified : Opus 4 à 72,5% (79,4% en high-compute), Sonnet 4 à 72,7%. Modèles hybrides combinant réponse instantanée et extended thinking. Opus 4 capable d’opérer plusieurs heures en continu. Tarification Opus 4 : 15 $/1M tokens en entrée, 75 $ en sortie.
Claude 4.5 (2025). Sonnet 4.5 (septembre 2025) : SWE-bench 77,2%, OSWorld 61,4%, GPQA Diamond 83,4%, AIME Python 100%. Opération autonome documentée sur plus de 30 heures. Haiku 4.5 (octobre 2025) : performances proches de Sonnet 4 à un tiers du coût (1 $/5 $ par million de tokens). Opus 4.5 (novembre 2025) : améliorations en coding et tâches bureautiques, taux de réponse problématique à 0,22% sur requêtes violatives single-turn.
Claude 4.6 (février 2026). Sonnet 4.6 (17 février) : SWE-bench 79,6%, OSWorld 72,5%, premier modèle Sonnet préféré à l’Opus de la génération précédente en évaluation coding (70% des cas vs Sonnet 4.5, 59% vs Opus 4.5). Introduit la fenêtre 1M tokens en beta. Opus 4.6 (5 février) : ajout des agent teams, intégration dans PowerPoint. Tarification des deux : 5 $/25 $ — soit une réduction de 66% par rapport à Opus 4.
Opus 4.7 et 4.8 (2026). Deux itérations intermédiaires, aujourd’hui classées en modèles hérités mais toujours servies. Opus 4.7 apporte un changement discret et lourd de conséquences : un nouveau tokeniseur. À nombre de tokens égal, la fenêtre porte désormais environ 555 000 mots au lieu de 750 000 — le compteur n’a pas changé de taille, c’est l’unité qui a changé de valeur. Un budget de contexte calibré sur l’ancien tokeniseur doit être recalculé.
Génération 5 (juillet-septembre 2026). Sonnet 5 et Opus 5 remplacent la lignée 4.x. Claude Opus 5 est sorti le 24 juillet 2026 (claude-opus-5, 1 M de contexte, 128 K de sortie, 5 $/25 $), avec deux ruptures pour le code écrit pour Opus 4.8 : la réflexion est active par défaut, et ne peut être désactivée qu’au niveau d’effort high ou en dessous.
Claude Fable 5.1 (1er septembre 2026). Nouveau sommet de gamme, au-dessus d’Opus (claude-fable-5-1, 1 M de contexte, 10 $/50 $). Anthropic recommande explicitement de commencer par Opus 5 et de ne passer à Fable 5.1 que pour le raisonnement exigeant et l’agentique de longue haleine, ou quand les évaluations sur Opus 5 poussé à effort élevé restent insuffisantes. Sa lecture de cache est facturée 0,25 $ par million de tokens — 2,5 % du prix d’entrée, contre 10 % sur le reste de la gamme, ce qui change l’économie des conversations longues bien plus que le prix affiché ne le laisse voir. Claude Mythos 5.1 offre les mêmes capacités, sur invitation seulement (Project Glasswing).
En clair : la trajectoire tient en trois mouvements. Le SWE-bench Verified — la résolution de bugs réels — est passé de 64 % en juin 2024 à 79,6 % en février 2026, soit 15 points en vingt mois ; au-delà, Anthropic ne publie plus ce comparatif sur ses pages modèles, et cette page ne l’invente pas. Le tarif du modèle de référence a chuté de 75 $ à 25 $ par million de tokens en sortie entre Opus 4 et Opus 5, soit 66 % de moins pour un modèle plus capable — mais un nouveau palier supérieur est apparu à 50 $, si bien que le haut de gamme, lui, a renchéri. Et le contexte est passé de 100 000 tokens à 1 million en standard, non plus en beta : l’équivalent d’environ 555 000 mots chargés à chaque requête.
Capacités
La gamme au 6 septembre 2026 (documentation constructeur)
| Modèle | Contexte | Sortie max | Prix entrée / sortie | Réflexion | Fin de connaissance | Retrait au plus tôt |
|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1 M | 128 K | 10 $ / 50 $ | adaptative, toujours active | juin 2026 | 1er sept. 2027 |
| Claude Opus 5 | 1 M | 128 K | 5 $ / 25 $ | adaptative | mai 2026 | 24 juil. 2027 |
| Claude Sonnet 5 | 1 M | 128 K | 2 $ / 10 $ | adaptative | janv. 2026 | 30 juin 2027 |
| Claude Haiku 4.5 | 200 K | 64 K | 1 $ / 5 $ | étendue | févr. 2025 | 15 oct. 2026 |
Prix en dollars par million de tokens. La lecture de cache coûte 10 % du prix d’entrée, sauf sur Fable 5.1 où elle tombe à 2,5 % (0,25 $). Les requêtes par lots sont remisées de 50 %.
Deux colonnes méritent l’attention d’un lecteur professionnel, parce qu’elles n’existaient pas dans les fiches produit d’il y a deux ans.
La fin de connaissance, d’abord : elle est désormais publiée pour chaque modèle, et elle s’étale sur seize mois d’écart entre le plus récent et le plus ancien de la gamme. Haiku 4.5 s’arrête en février 2025 quand Fable 5.1 va jusqu’à juin 2026. Deux modèles de la même marque, servis le même jour, n’ont pas la même idée de ce qu’est le présent.
Le retrait au plus tôt, ensuite : Anthropic s’engage sur une date en deçà de laquelle un modèle ne sera pas retiré. C’est une information de gouvernance, pas de performance — elle dit combien de temps une intégration peut vivre sans être reprise. Haiku 4.5 est le plus exposé : sa date est en octobre 2026.
Modèles hérités encore servis : Fable 5, Opus 4.8, 4.7, 4.6, 4.5, Sonnet 4.6 et 4.5.
La réflexion a changé de mode
Jusqu’à la génération 4.6, la réflexion était étendue : le développeur activait un mode et fixait un budget de tokens. Depuis, elle est adaptative : le modèle décide lui-même de la profondeur, orientée par un paramètre effort dont la valeur par défaut est high. Le mode manuel est déprécié sur Opus 4.6 et Sonnet 4.6, et refusé sur les modèles suivants. Sur Fable 5.1, l’adaptatif est le seul mode disponible.
Ce n’est pas un détail d’API : le curseur de « combien le modèle réfléchit avant de répondre » est passé de la main du développeur à celle du modèle, le développeur ne gardant qu’un réglage d’intention. Un code qui fixait un budget de réflexion en dur ne fonctionne plus tel quel.
Benchmarks publiés (données constructeur, générations 3.5 à 4.6)
| Modèle | SWE-bench | OSWorld | GPQA Diamond |
|---|---|---|---|
| Claude 3.5 Sonnet | 64% (interne) | — | — |
| Claude Opus 4 | 72,5% (79,4% high-compute) | — | — |
| Claude Sonnet 4 | 72,7% | — | — |
| Claude Sonnet 4.5 | 77,2% | 61,4% | 83,4% |
| Claude Sonnet 4.6 | 79,6% | 72,5% | — |
SWE-bench Verified mesure la résolution de bugs réels dans des dépôts open-source. OSWorld évalue le contrôle d’interface sur un système d’exploitation en conditions réelles.
Points forts documentés
Coding et résolution de bugs. Claude occupe les premières positions sur SWE-bench depuis plusieurs générations. Sonnet 4.6 atteint 79,6%, Sonnet 4.5 avait enregistré 100% sur AIME Python.
Raisonnement multi-étapes. L’extended thinking (depuis 3.7) permet un budget de réflexion configurable avant la réponse finale. Utile pour les problèmes mathématiques, logiques ou d’ingénierie.
Analyse de documents longs. Le contexte de 1 million de tokens est passé de la beta au standard sur Fable 5.1, Opus 5 et Sonnet 5 — environ 555 000 mots, soit un corpus entier de documentation ou une base de code complète. Attention au recalcul : le tokeniseur introduit avec Opus 4.7 fait tenir moins de mots dans le même nombre de tokens qu’auparavant (555 000 contre environ 750 000).
Contrôle d’interface. Computer Use (depuis 3.5 Sonnet v2) permet à Claude de contrôler un navigateur ou un bureau. OSWorld 72,5% sur Sonnet 4.6 en fait le modèle le plus performant mesuré sur cette tâche à cette date.
Vision. Disponible depuis Claude 3. Jusqu’à 600 images ou pages PDF par requête. Interprétation de charts, graphiques, tableaux.
En clair : retenir trois cas d’usage où Claude se distingue franchement. Premièrement, le code production — 79,6 % des instances de SWE-bench Verified sont résolues dans les conditions publiées du banc. Ce n’est pas 79,6 % des bugs réels : le jeu de test est constitué de tickets d’un périmètre choisi, avec un critère de réussite automatisable, ce qui ne ressemble ni à la difficulté ni à la forme d’un bug rencontré en production. Deuxièmement, l’analyse documentaire massive — 200k tokens couvrent un cahier des charges entier de 500 pages, et la beta 1M absorbe une base de code complète. Troisièmement, le contrôle d’interface — Sonnet 4.6 atteint 72,5 % sur OSWorld, l’un des rares bancs qui mesurent un agent face à un système d’exploitation réel plutôt que face à une page web.
Choisir le bon tier Claude
| Contexte | Recommandation | Pourquoi |
|---|---|---|
| Cas général, y compris le code et le travail d’entreprise | Opus 5 | C’est le point de départ recommandé par Anthropic elle-même. 5 $/25 $, contexte 1 M, réflexion adaptative. |
| Tâche conversationnelle légère, support en volume, contrainte budgétaire forte | Haiku 4.5 | 1 $/5 $, la latence la plus basse de la gamme. Contexte 200 K et connaissance arrêtée en février 2025 : à écarter dès que l’actualité compte. |
| Analyse standard, rédaction, code de complexité moyenne | Sonnet 5 | 2 $/10 $ pour le même contexte de 1 M que le haut de gamme. Le meilleur rapport volume/prix. |
| Raisonnement exigeant, agentique de longue haleine, ou échec avéré d’Opus 5 poussé à effort élevé | Fable 5.1 | 10 $/50 $ et plus lent — le surcoût ne se justifie qu’après avoir mesuré l’insuffisance d’Opus 5, pas avant. Lecture de cache à 0,25 $, ce qui rend les conversations longues moins chères qu’il n’y paraît. |
| Conversation très longue avec beaucoup de contexte réutilisé | Fable 5.1, à calculer | La lecture de cache y coûte 2,5 % du prix d’entrée contre 10 % ailleurs : sur un contexte relu des dizaines de fois, l’écart de prix affiché s’inverse parfois. |
| Génération d’images en sortie ou recherche web sans outils | Hors scope Claude | Capacités absentes nativement — orienter vers OpenAI ou Gemini selon le besoin. |
Limites connues
Pas de génération d’images. Claude analyse des images en entrée mais ne produit pas d’images en sortie. Capacité absente nativement, sans annonce de feuille de route.
Hallucinations. Le taux varie selon les tâches : environ 4,4% sur la synthèse de documents standard, autour de 10% sur des benchmarks difficiles pour Opus 4 (source : Suprmind, 2026). Les modèles en extended thinking peuvent « sur-penser » et s’éloigner du matériau source. Le Constitutional AI incite le modèle à signaler son incertitude plutôt qu’à halluciner avec assurance — ce qui réduit les erreurs confiantes, mais pas les erreurs totales.
Fin de connaissance. Elle est désormais publiée modèle par modèle, ce qui n’était pas le cas jusqu’en 2026 : juin 2026 pour Fable 5.1, mai 2026 pour Opus 5, janvier 2026 pour Sonnet 5, février 2025 pour Haiku 4.5. L’écart de seize mois à l’intérieur d’une même gamme est en soi une limite d’usage : le modèle le moins cher est aussi celui qui ignore le plus de choses. Sans outil de recherche web, Claude ne dispose d’aucune information postérieure à cette date.
Erreurs sur le code long. Des erreurs ont été documentées lors de la génération d’un seul bloc de code très long. La pratique recommandée est de décomposer en étapes.
Pas d’accès internet natif. Sauf via des outils externes (MCP servers, web search intégré selon les plans). Claude opère sur sa connaissance figée par défaut.
Ce qu’il faut retenir
La nomenclature à trois tiers, stable de mars 2024 à l’été 2026, a cessé de l’être. La gamme compte quatre modèles et le plus capable ne s’appelle plus Opus. Pour qui écrit du code ou rédige une note d’architecture, la leçon est plus utile que le nom lui-même : un identifiant de modèle écrit en dur est une date de péremption déguisée.
La progression reste mesurable sur la partie publiée : SWE-bench passe de 64 % (3.5 Sonnet) à 79,6 % (Sonnet 4.6). Au-delà, Anthropic ne publie plus ce comparatif sur ses pages modèles — cette page s’arrête donc là plutôt que de citer des agrégateurs.
Les points forts objectifs restent le code, l’analyse de documents longs et le contrôle d’interface. Les limites structurelles restent l’absence de génération d’images et un taux d’hallucination non négligeable sur les tâches difficiles. La fin de connaissance, elle, n’est plus une inconnue : elle est publiée, et son écart de seize mois entre le haut et le bas de gamme est devenu un critère de choix à part entière.
Le tarif du modèle de référence a baissé de 66 % entre Opus 4 (15 $/75 $) et Opus 5 (5 $/25 $). Mais un palier supérieur est apparu au-dessus à 10 $/50 $ : le marché ne baisse pas, il s’étale. Ce qui a vraiment changé l’économie d’usage n’est d’ailleurs pas le prix affiché mais celui de la lecture de cache, tombée à 2,5 % du prix d’entrée sur Fable 5.1 — sur une conversation longue relue des dizaines de fois, c’est le poste qui domine la facture.