On a passé des mois à comparer des scores Benchmarks, des indices d’intelligence.
Pendant ce temps, deux choses ont changé silencieusement :
Fable 5 s’est déplacé vers le haut de la pyramide des abonnements.
Kimi K3 a fixé une date pour déposer ses poids ouverts : le 27 juillet 2026.
Ce n’est plus juste une bataille de performance.
C’est une bataille d’accès.
1. Fable 5 : le plafond qui remonte
Fable 5 est, à ce jour, un des modèles les plus forts côté intelligence globale.
Indices d’évaluation sérieux le placent devant Kimi K3 sur la suite complète de tests, avec des scores autour de 60 sur certains index, contre ~57–58 pour K3.
Mais là où ça se joue désormais pour beaucoup de gens,
ce n’est pas dans le score.
C’est dans la façon dont tu y accèdes.
Anthropic a stabilisé la politique suivante :
Max et Team Premium :
Fable 5 reste inclus dans l’abonnement,
mais limité à 50 % des crédits hebdo.
Pro et Team Standard :
Fable 5 n’est plus inclus ;
tu reçois un crédit unique de 100 $ pour l’utiliser ;
après ça, chaque token est facturé au tarif API (10 $/M input, 50 $/M output).
Côté API, rien ne bouge :
Fable 5 reste accessible au tarif usage (10 $/M input, 50 $/M output).
Mais pour une personne non technique, qui consomme Fable via l’app :
avoir Fable ou ne pas l’avoir dépend désormais :
de ton niveau d’abonnement ;
de ta capacité à gérer credits, limites, factures.
Les taux se resserrent.
Pas sur la capacité du modèle,
mais sur qui a le droit de le toucher
et sous quelles conditions.
2. Kimi K3 : un modèle ouvert avec une date
En face, Kimi K3 arrive avec une posture très différente :
2,8 T paramètres, Mixture‑of‑Experts, 16 experts actifs par token ;
contexte 1 048 576 tokens (1 M) ;
attention et scaling optimisés pour le long contexte, avec des décodages annoncés jusqu’à ~6,3× plus rapides qu’une génération précédente.
Mais la vraie clé, ce n’est pas que la fiche technique.
C’est que Moonshot a attaché une date à son claim “open‑weights” :
modèle lancé mi‑juillet sur Kimi.com, Kimi Work, Kimi Code et l’API.
poids complets téléchargeables promis pour le 27 juillet 2026, sous licence Modified MIT, via Hugging Face.
Aujourd’hui, quand tu lis “Kimi K3 est open‑weights” :
ce n’est pas encore un modèle que tu télécharges ce soir ;
c’est un modèle hébergé,
avec une date claire pour le moment où tu pourras :le télécharger ;
le packager ;
le faire tourner dans ton infra, si tu as les moyens de le supporter.
Ce n’est pas du fantasme.
C’est une promesse avec échéance.
3. Scores vs réalité : qui fait quoi, et à quel coût ?
Sur le terrain des benchmarks :
Fable 5 :
mieux classé sur la suite complète (intelligence globale, raisonnement, tâches difficiles).
Kimi K3 :
gagne sur certains tests de coding agentique (Terminal Bench, Frontend Code Arena, certaines simulations),
se place #3 ou #4 dans les indices globaux, avec des performances très solides sur les tâches de travail réel.
Sur le terrain du coût :
Fable 5 :
API à 10 $/M tokens input et 50 $/M tokens output,
ce qui loque le modèle dans une catégorie “premium” sur les tâches volumétriques.
Kimi K3 :
API autour de 3 $/M input et 15 $/M output, cache‑hit à ~0,30 $/M sur certaines boucles,
positionné clairement comme un open default pour le travail lourd mais mesurable.
Sur le terrain de l’accès utilisateur :
Fable 5 :
non‑techniques dépendants de Pro / Max / Team ;
accès qui se fragmente et se monétise fortement après un tampon de 100 $.
Kimi K3 :
utilisable dès maintenant via app et API ;
puis auto‑hébergeable après le 27 juillet, si tu as une infra sérieuse.
4. Stratège vs exécutant, mais avec une nouveauté : qui peut entrer dans la salle ?
Dans la version précédente de l’article,
je te parlais de Fable 5 comme stratège
et de Kimi K3 comme exécutant.
Ce cadre reste valable :
Fable 5 pour :
la feuille de route ;
les choix difficiles ;
les arbitrages où une erreur coûte plus que le prix des tokens.
Kimi K3 pour :
les tâches volumétriques ;
le vibe coding ;
les refactors ;
les simulations et builds où tu peux mesurer la qualité et jouer sur le coût.
La nouveauté, c’est :
qui peut jouer ce duo, et où.
Côté Fable 5 :
non‑techniques sur Pro / Team Standard doivent se soucier des crédits, des limites, des factures.
Côté Kimi K3 :
à partir du 27 juillet, des équipes infra peuvent décider de se passer des plans hauts de gamme chez Anthropic,
en faisant tourner Kimi K3 dans des environnements qu’elles contrôlent, tout en laissant Fable intervenir quand son jugement apporte une vraie valeur marginale.
Tu ne choisis plus seulement “qui est le mieux noté”.
Tu choisis :
qui est accessible à ton niveau technique ;
qui est supportable à ton niveau de budget ;
qui est hébergeable à ton niveau d’infrastructure.
5. Ce que tu peux faire concrètement (en prenant en compte ces nouvelles règles)
Si tu as Fable 5 et Kimi K3 sous la main,
je te propose une version mise à jour du test que j’évoquais :
Vérifie ton plan Fable :
Pro / Team Standard : regarde le crédit de 100 $, ce qu’il couvre vraiment, et le tarif après.
Max / Team Premium : regarde ce que représente 50 % de tes crédits hebdo en usage Fable.
Choisis un projet réel (pas un jouet).
refactor massif ;
grosse feature ;
simulation ;
pipeline data.
Demande à Fable 5 :
la feuille de route complète ;
les risques ;
les arbitrages ;
les prompts ou briefs pour un modèle d’exécution.
Passe l’exécution volumique sur Kimi K3 :
même contexte ;
mêmes briefs ;
mesure : temps, qualité, nombre d’interventions humaines, facture.
Et si tu es dans une équipe qui pourra jouer avec les weights :
prépare‑toi à regarder ce que le drop du 27 juillet change vraiment :
sur ta souveraineté ;
sur ta facture ;
sur ton architecture.
6. Le point de bascule, ce n’est plus le benchmark, c’est l’accès
Ce que je veux que tu retiennes de cette mise à jour, ce n’est pas un nouveau “vainqueur”.
C’est ceci :
Les modèles fermés déplacent progressivement la frontière de ce qui est accessible dans les abonnements.
Les modèles ouverts fixent des dates pour donner au public le droit de les télécharger et de les intégrer dans leurs propres architectures.
Le jour où tu compares ces modèles, ne regarde plus seulement :
“qui a le meilleur score ?”
Regarde aussi :
“qui laisse qui entrer dans la salle,
sous quelles conditions,
et pour faire quoi ?”
Et ensuite, fais ton choix non pas en fonction de la hype, mais en fonction de ton métier, de ton budget et de ton niveau de contrôle sur l’IA que tu fais tourner.


