Claude Fable 5.1 domine les benchmarks, mais la Chine gagne la bataille des prix
Anthropic a présenté son nouveau modèle Claude Fable 5.1 comme le plus avancé au monde pour le codage et les tâches complexes. Il écrase ses rivaux chinois sur les indices de performance. Pourtant, ces mêmes rivaux restent jusqu’à cinq fois moins chers à l’usage – un écart qui soulève une vraie question : la puissance brute suffit-elle à gagner la course à l’IA ?
- Claude Fable 5.1 s’impose en tête des principaux benchmarks IA, devant les modèles chinois Kimi K3 et GLM-5.3.
- Malgré une baisse de prix, Fable 5.1 coûte 4 fois plus cher à l’usage que ses concurrents chinois.
- La Chine continue de progresser : Alibaba et Z.ai publient de nouveaux modèles compétitifs cette semaine.
Un bond de performance qui relance le débat sur la parité technologique
Anthropic a publié mercredi son modèle Claude Fable 5.1, accompagné d’une version à accès restreint baptisée Mythos 5.1. La société américaine affirme que ces deux modèles représentent l’état de l’art mondial pour le codage logiciel et les tâches intellectuelles complexes.
Les chiffres plaident en leur faveur. Sur l’Intelligence Index d’Artificial Analysis, Fable 5.1 obtient un score de 66. Il devance de six points le Kimi K3 de Moonshot AI et le GLM-5.3 de Z.ai, deux des meilleurs modèles chinois actuels. Il prend aussi la première place sur l’index de Vals AI, qui mesure les performances sur des cas d’usage réels dans la finance, le droit et la programmation.
Cette avance a surpris une partie des observateurs. Certains experts avaient estimé que les modèles chinois en open-weight avaient déjà comblé l’écart avec les leaders américains. Yuchen Jin, membre du personnel technique chez Databricks, a qualifié le bond de capacité de Fable 5.1 d' »insensé ». Le résultat semble contredire ce narratif de rattrapage.
- Score de 66 sur l’Intelligence Index pour Fable 5.1, soit +6 points sur les leaders chinois.
- Coût par tâche : 3,69 $ pour Fable 5.1, contre 0,84 $ pour Kimi K3 et 0,68 $ pour GLM-5.3.
- Anthropic a réduit le prix des lectures en cache de 75 %, abaissant les dépenses totales des utilisateurs jusqu’à 45 %.
- Le modèle Qwen3.8-Max-0902 d’Alibaba a pris la tête du benchmark d’Arena AI pour le développement web cette semaine.
- Les modèles en open-weight sont des IA dont les paramètres sont publiquement accessibles, ce qui permet à d’autres développeurs de les utiliser et de les adapter librement.
- La Chine a multiplié les publications de modèles compétitifs depuis début 2025, souvent à des prix très inférieurs aux standards américains.
- Les benchmarks IA mesurent la performance sur des tâches standardisées, mais ne reflètent pas toujours les performances réelles en entreprise.

Le vrai fossé : une guerre des prix que les Américains peinent à gagner
La performance a un coût. Et c’est là que le tableau devient moins flatteur pour Anthropic.
Même après une réduction tarifaire significative, Fable 5.1 coûte 3,69 dollars par tâche sur l’Intelligence Index. Kimi K3 revient à 0,84 dollar. GLM-5.3 de Z.ai descend à 0,68 dollar. L’écart est massif : les modèles chinois coûtent entre quatre et cinq fois moins cher à l’usage.
Tory Green, cofondateur de la société d’infrastructure IA io.net, a résumé la dynamique de façon claire sur les réseaux sociaux : « Les modèles open-weight bon marché captent les tâches d’agent routinières, tandis que Fable est sollicité quand la tâche est suffisamment difficile pour justifier la prime. » Ce positionnement semble indiquer une segmentation naturelle du marché, plutôt qu’une compétition frontale sur tous les segments.
Pour les entreprises qui traitent de grandes quantités de requêtes standardisées, la différence de prix peut rapidement devenir décisive. La supériorité technique de Fable 5.1 ne suffit pas nécessairement à justifier un coût quatre à cinq fois supérieur pour des tâches qui ne requièrent pas le meilleur modèle disponible.
La Chine ne s’arrête pas : Alibaba et Z.ai publient de nouveaux modèles
Pendant qu’Anthropic présente Fable 5.1, les acteurs chinois continuent leur propre cadence de publication. Alibaba – propriétaire du South China Morning Post – a lancé mercredi Qwen3.8-Max-0902. Ce modèle a pris la tête du benchmark d’Arena AI dédié au développement web front-end, dépassant notamment Claude Opus 5 et Kimi K3.
De son côté, le fondateur de Z.ai, Tang Jie, a annoncé cette semaine à des investisseurs que son prochain modèle GLM-6.0 viserait l’amélioration récursive autonome. Cette capacité permettrait au modèle de s’entraîner lui-même à produire son successeur, sans intervention humaine directe. Une ambition qui rejoint ce que le PDG de Vals AI, Rayan Krishnan, a déjà observé en test préliminaire chez Fable 5.1 lui-même.
Ces annonces simultanées montrent que la course ne se joue pas en séquence. Les deux écosystèmes avancent en parallèle, et les leads peuvent changer d’une semaine à l’autre selon les critères retenus.
Sécurité et transparence : une autre ligne de fracture entre les deux camps
La compétition sur les benchmarks n’est pas le seul point de tension. La question de la sécurité des modèles monte en puissance des deux côtés du Pacifique.
OpenAI a annoncé mercredi son prochain modèle Astra, capable selon la société de détecter et d’exploiter des vulnérabilités inconnues dans des systèmes bien protégés, sans intervention humaine. L’entreprise promet des garde-fous stricts et un accès restreint. Mais des chercheurs en sécurité ont exprimé des inquiétudes sérieuses.
Selon le site The Information, Astra utilise une architecture dite de « profondeur récurrente ». Cette conception améliore les performances, mais rend opaque le raisonnement interne du modèle. Ryan Greenblatt, chercheur en chef chez Redwood Research, a averti que cette technique nuisait à la supervision humaine. Il l’a décrit comme « peut-être le développement le plus néfaste à ce jour pour la sécurité de l’IA ».
Cette dimension sécuritaire semble indiquer que la course à la puissance brute s’accompagne d’arbitrages de plus en plus difficiles sur la transparence et le contrôle des systèmes.
- Fable 5.1 reprend le leadership sur les benchmarks, contredisant l’idée d’un rattrapage chinois accompli.
- L’écart de prix – 3,69 $ contre moins de 1 $ – favorise les modèles chinois sur les usages à fort volume.
- Alibaba et Z.ai publient des modèles compétitifs dans la même semaine, maintenant la pression sur les acteurs américains.
- La course à la performance soulève des questions croissantes sur la sécurité et la transparence des modèles des deux côtés.

Performance ou accessibilité : deux visions de l’IA qui s’affrontent
La semaine de publication de Fable 5.1 illustre une fracture qui semble se creuser dans l’écosystème mondial de l’IA. D’un côté, les laboratoires américains poussent les limites de la performance pure, en acceptant des coûts d’usage élevés. De l’autre, les acteurs chinois construisent des modèles compétitifs à des prix qui favorisent l’adoption massive. Ces deux stratégies ciblent des segments différents – et toutes deux peuvent coexister sur le marché mondial. La vraie question n’est peut-être pas qui est le meilleur, mais qui sera le plus utilisé.
Et vous, pensez-vous que la performance justifie un coût cinq fois plus élevé ? Donnez votre avis en commentaire.
Sources : South China Morning Post
