Kimi K3 est le nouveau modèle d’intelligence artificielle lancé le 16 juillet 2026 par la startup pékinoise Moonshot AI. Avec 2 800 milliards de paramètres, c’est le plus grand modèle open weight jamais annoncé : les benchmarks indépendants le placent troisième mondial, juste derrière Claude Fable 5 et GPT-5.6 Sol, pour un tarif API de 3 dollars par million de tokens en entrée et 15 dollars en sortie. Les poids seront publiés d’ici le 27 juillet 2026. Voici ce qui est confirmé, ce qui relève de la communication de Moonshot, et comment le tester dès aujourd’hui.
Kimi K3 en bref : les chiffres qui font du bruit
- 2 800 milliards de paramètres : premier modèle ouvert de « classe 3T », presque le double du précédent record open weight.
- Fenêtre de contexte de 1 million de tokens, avec vision native intégrée à l’architecture.
- Troisième sur tous les grands index indépendants d’Artificial Analysis : Intelligence (57), Coding (76,2), Agentic (50,1), derrière Claude Fable 5 et GPT-5.6 Sol uniquement.
- Premier sur l’arène Frontend Code d’Arena.ai, devant Claude Fable 5.
- Tarif : 3 $/M tokens en entrée, 15 $/M en sortie, exactement le prix de Claude Sonnet 5. C’est le modèle chinois le plus cher jamais commercialisé.
- Poids ouverts promis pour le 27 juillet 2026. D’ici là, accès via kimi.com, l’API officielle et OpenRouter.
Pourquoi ce lancement fait trembler la Silicon Valley
Le timing n’a rien d’un hasard. Moonshot AI, soutenue par Alibaba, a dégainé Kimi K3 quelques jours avant la World Artificial Intelligence Conference 2026 de Shanghai. L’agence AP décrit un secteur américain « pris par surprise », un remake du moment DeepSeek de janvier 2025, mais à une échelle supérieure. Fortune titre carrément que le modèle pousse l’IA chinoise « en territoire Fable », du nom du modèle le plus avancé d’Anthropic.
Le symbole compte autant que la technique. Un laboratoire qui publie les poids d’un modèle de classe frontière, c’est une première : jusqu’ici, les modèles ouverts couraient six à douze mois derrière les systèmes propriétaires. Kimi K3 réduit cet écart à quelques points d’index. Pour une partie de l’industrie, cela valide la stratégie du poids ouvert comme arme concurrentielle ; pour l’autre, cela pose la question du modèle économique des laboratoires fermés. Nous avions analysé cette guerre entre IA open source et modèles propriétaires : K3 vient d’en déplacer la ligne de front.
Une architecture pensée pour les longues sessions
Sous le capot, Moonshot met en avant deux innovations. La première, Kimi Delta Attention, est un mécanisme d’attention conçu pour traiter efficacement les très longues séquences, ce qui rend exploitable la fenêtre de 1 million de tokens sans faire exploser les coûts de calcul. La seconde, les résidus d’attention (attention residuals), stabilise l’entraînement des réseaux très profonds.
La vision est native : le modèle traite les images dans la même architecture que le texte, au lieu d’un module greffé après coup. Moonshot positionne l’ensemble sur trois usages : le code au long cours sur de gros dépôts, le travail de connaissance (analyse de documents, tableurs, navigation) et le raisonnement. À noter pour les abonnements grand public : la fenêtre complète de 1 million de tokens est réservée aux paliers supérieurs et à l’API, les formules d’entrée étant limitées autour de 256 000 tokens.
Benchmarks : que valent vraiment les chiffres ?
Les benchmarks internes de Moonshot donnent K3 devant Claude Opus 4.8 et GPT-5.5, mais derrière Claude Fable 5 et GPT-5.6 Sol. Réflexe sain : se méfier des chiffres maison. Sauf que cette fois, les évaluations indépendantes confirment l’essentiel.
Artificial Analysis, référence des mesures tierces, place Kimi K3 à 76,2 sur son Coding Index, à 0,3 point seulement de Claude Fable 5, et loin devant Claude Opus 4.8. Sur l’index Intelligence, K3 obtient 57 contre 60 pour Fable 5 et 59 pour GPT-5.6 Sol. Sur l’évaluation privée de travail de connaissance au long cours, le modèle atteint un Elo de 1547, un bond de 732 points par rapport à Kimi K2.6, derrière le seul Fable 5. Et sur l’arène Frontend Code d’Arena.ai, jugée par votes à l’aveugle, K3 prend la première place mondiale.
La lecture honnête : Kimi K3 ne « bat » pas les meilleurs modèles fermés, contrairement à ce que certains titres laissent entendre. Il s’installe sur le podium, systématiquement troisième, ce qu’aucun modèle ouvert n’avait approché. Pour situer l’écart avec la génération précédente de modèles ouverts, relisez notre comparatif DeepSeek vs Claude Sonnet : l’époque où l’ouvert jouait une division en dessous paraît soudain lointaine.
Un prix qui dit tout de l’ambition de Moonshot
Le tarif est peut-être l’information la plus stratégique du lancement : 3 dollars par million de tokens en entrée, 15 dollars en sortie. C’est exactement la grille de Claude Sonnet 5, et environ trois fois le prix de Kimi K2.6 (0,95 $/4 $). Moonshot ne vend plus un modèle chinois low cost, mais un concurrent frontière assumé.
Rapporté à la performance, le calcul reste favorable. Sur le coût par tâche mesuré par Artificial Analysis, K3 revient à environ 0,94 $ par tâche, contre 1,04 $ pour GPT-5.6 Sol, 1,80 $ pour Claude Opus 4.8 et 2,75 $ pour Claude Fable 5. Autrement dit : des performances proches du haut du panier pour un tiers du coût par tâche du leader. Les développeurs qui utilisent déjà Claude Sonnet 5 via l’API ont désormais un point de comparaison direct, au même prix facial.
Tester Kimi K3 dès maintenant via l’API
Pas besoin d’attendre les poids : le modèle est déjà servi par l’API Moonshot et par OpenRouter, compatible avec le format OpenAI. Exemple minimal en cURL :
curl https://openrouter.ai/api/v1/chat/completions
-H "Authorization: Bearer $OPENROUTER_API_KEY"
-H "Content-Type: application/json"
-d '{
"model": "moonshotai/kimi-k3",
"messages": [
{"role": "user",
"content": "Audite ce htaccess et propose des corrections."}
]
}'
Ou en Python, avec le SDK OpenAI standard :
from openai import OpenAI
client = OpenAI(
base_url="https://openrouter.ai/api/v1",
api_key="VOTRE_CLE_OPENROUTER",
)
reponse = client.chat.completions.create(
model="moonshotai/kimi-k3",
messages=[{"role": "user", "content": "Explique Kimi Delta Attention en 3 phrases."}],
)
print(reponse.choices[0].message.content)
Attention au budget : K3 n’expose pour l’instant qu’un seul niveau de raisonnement, « max ». Simon Willison rapporte qu’une simple génération de SVG a consommé plus de 13 000 tokens de raisonnement pour un coût de 25 centimes. Sur des boucles agentiques longues, surveillez la facture.
Les limites et zones d’ombre à connaître
- Les poids ne sont pas encore publiés. La promesse du 27 juillet 2026 reste une promesse ; tant que les fichiers ne sont pas sur Hugging Face, K3 est un modèle propriétaire avec un communiqué.
- Un seul effort de raisonnement, réglé au maximum : impossible pour l’instant d’arbitrer coût contre profondeur de réflexion, là où les modèles d’Anthropic et d’OpenAI offrent plusieurs niveaux.
- L’auto-hébergement sera réservé à une élite. À 2 800 milliards de paramètres, même quantifié, le modèle exigera une infrastructure multi-GPU hors de portée d’un développeur individuel. La vraie retombée open source viendra des distillations et des fine-tunings dérivés ; notre tutoriel LoRA et QLoRA explique ces techniques.
- Un mystérieux prompt système caché d’environ 85 tokens a été repéré dans le comptage de l’API, sans documentation officielle. Rien de grave, mais un manque de transparence relevé par la communauté.
- Licence encore floue au moment de la publication : « open weight » ne veut pas dire open source au sens OSI, et les conditions exactes d’usage commercial seront à vérifier le 27 juillet.
Ce que Kimi K3 change pour la suite
Si Moonshot tient sa promesse du 27 juillet, l’écosystème disposera pour la première fois d’un modèle de classe frontière librement téléchargeable, affinable et auditables par des chercheurs indépendants. Les fournisseurs d’inférence se préparent déjà à le servir, et la pression tarifaire sur les modèles fermés va s’intensifier : pourquoi payer le prix fort si un modèle troisième mondial coûte un tiers du leader par tâche ?
Pour Anthropic et OpenAI, la réponse s’appelle vitesse d’exécution : creuser l’écart de capacités plus vite que l’open weight ne le comble. Pour les équipes techniques, le conseil est plus prosaïque : testez K3 sur vos propres cas d’usage via l’API, comparez le coût réel par tâche avec votre modèle actuel, et gardez un œil sur le 27 juillet. Le bruit médiatique passera ; un troisième acteur crédible au prix de Sonnet 5, lui, restera.
FAQ : vos questions sur Kimi K3
Qu’est-ce que Kimi K3 exactement ?
Kimi K3 est le modèle d’IA le plus avancé de Moonshot AI, startup pékinoise soutenue par Alibaba. Lancé le 16 juillet 2026, il compte 2 800 milliards de paramètres, accepte 1 million de tokens de contexte et traite nativement les images. Ses poids doivent être publiés d’ici le 27 juillet 2026.
Kimi K3 est-il vraiment meilleur que Claude ou GPT ?
Non, pas tout à fait. Les évaluations indépendantes d’Artificial Analysis le classent troisième, derrière Claude Fable 5 et GPT-5.6 Sol, mais devant Claude Opus 4.8 et GPT-5.5. Il prend en revanche la première place sur l’arène Frontend Code d’Arena.ai.
Combien coûte Kimi K3 ?
L’API est facturée 3 dollars par million de tokens en entrée et 15 dollars par million en sortie, soit le même tarif que Claude Sonnet 5. Le coût moyen par tâche mesuré par Artificial Analysis est d’environ 0,94 dollar.
Peut-on faire tourner Kimi K3 en local ?
En pratique, non. Avec 2 800 milliards de paramètres, le modèle dépasse largement les capacités d’une machine individuelle, même haut de gamme. L’accès réaliste passe par l’API officielle ou OpenRouter ; les poids ouverts serviront surtout aux fournisseurs d’inférence et à la recherche.
Quand les poids de Kimi K3 seront-ils disponibles ?
Moonshot AI s’est engagée à publier les poids « d’ici le 27 juillet 2026 ». Tant que cette publication n’a pas eu lieu, Kimi K3 reste accessible uniquement via kimi.com et l’API.
Sources
- Annonce officielle Kimi K3, Moonshot AI
- AP News : Chinese startup Moonshot unveils powerful Kimi K3 AI model
- Fortune : Moonshot’s Kimi K3 pushes Chinese AI into Fable-level territory
- Simon Willison : Kimi K3 and the pelican benchmark
- Better Stack : Kimi K3, the open-source model that competes with frontier AI
- OpenRouter : fiche API et tarifs Kimi K3
Pour aller plus loin, consultez notre comparatif complet Kimi K3 vs Claude Fable 5 vs GPT-5.6 Sol : benchmarks sourcés, prix API et verdict selon votre usage.
Commentaires (0)
Laisser un commentaire
Les commentaires sont modérés. Questions WordPress, cybersécurité ou dev web bienvenues.