
L’essentiel en bref
- Moonshot AI a sorti Kimi K3 le 16 juillet 2026 : 2 800 milliards de paramètres, 1 million de tokens de contexte, vision native.
- Le modèle atteint la 3e place de l’Artificial Analysis Intelligence Index, derrière Claude Fable 5 et GPT-5.6 Sol.
- En juin, Anthropic a suspendu Fable 5 pendant 19 jours pour se conformer à une directive d’export américaine.
- Les poids de Kimi K3 ne sont pas encore publics : Moonshot les annonce pour le 27 juillet 2026.
Accès rapide (Sommaire) :
Le vrai sujet : un modèle propriétaire peut être éteint, pas un modèle ouvert
Le 12 juin 2026, le gouvernement américain a émis une directive de contrôle à l’export visant Claude Fable 5 et Claude Mythos 5.
L’ordre interdisait l’accès à ces modèles pour tout ressortissant étranger, à l’intérieur comme à l’extérieur des États-Unis.
Les salariés non américains d’Anthropic étaient inclus.
L’entreprise ne pouvait pas vérifier la nationalité de chaque utilisateur en temps réel.
Elle a donc coupé les deux modèles pour tout le monde, du jour au lendemain.
Le Département du Commerce a levé la mesure le 30 juin et Anthropic a rétabli l’accès le 1er juillet.
Bilan : 19 jours d’interruption pour des clients entreprises répartis sur des dizaines de plateformes cloud.
Aucune décision administrative ne produira jamais ce résultat sur un modèle en open weight.
Une fois les poids téléchargés et copiés, personne ne les rappelle.
C’est la différence de nature entre les deux offres, et elle pèse plus lourd qu’un écart de trois points sur un benchmark.
Si vous avez subi la coupure de juin, vous avez déjà exploré les solutions de repli disponibles à ce moment-là.
Ce que Moonshot a réellement livré avec Kimi K3
Kimi K3 est sorti le 16 juillet 2026 et il a fait trembler la tech Américaine. C’est un modèle Mixture-of-Experts de 2 800 milliards de paramètres, qui active 16 experts sur 896 à chaque token.
Il embarque une fenêtre de contexte d’un million de tokens et une compréhension visuelle native.
Sur l’Artificial Analysis Intelligence Index, il obtient environ 57 points et se place 3e au classement général, une première pour un modèle ouvert !
Devant lui ? Il n’y a que les gros noms du secteur, Claude Fable 5 et GPT-5.6 Sol et Moonshot le reconnaît lui-même dans son annonce officielle.
Cette honnêteté est rare dans les communiqués de lancement, et elle mérite d’être soulignée.
Le rattrapage technique est donc réel, mais il n’est pas encore un dépassement.
Pour situer K3 par rapport aux autres, notre classement des principaux modèles de langage reste le point de repère le plus large.
« Ouvert » mais peu accessible
Voilà le point que la plupart des personnes oublient.
Si vous pouvez sur le papier télécharger K3 librement, Moonshot recommande 64 accélérateurs ou plus pour servir le modèle correctement. Autrement dit, vous obtenez le droit d’héberger K3, mais pas la capacité de le faire, à moins d’avoir des centaines de milliers d’euros en équivalent serveur à disposition.
Pour la quasi-totalité des PME et des ETI françaises, l’open weight de ce niveau restera donc inaccessible économiquement, sans passer par l’API.
Washington a répondu en quatre jours, sur le terrain réglementaire
Le 22 juillet, Michael Kratsios, directeur du bureau de la politique scientifique et technologique de la Maison-Blanche, a publiquement mis en cause Moonshot.
Selon lui, l’entreprise aurait acquis des serveurs équipés de puces Nvidia GB300 et y aurait accédé depuis la Thaïlande, probablement pour entraîner ses modèles.
Ces puces de génération Blackwell sont interdites à la vente aux entreprises chinoises.
Kratsios accuse aussi Moonshot d’avoir mené de la distillation à grande échelle contre des modèles américains, en citant nommément Fable.
La distillation consiste à entraîner un modèle sur les sorties d’un modèle concurrent pour en reproduire une partie des capacités.
Le secrétaire au Trésor Scott Bessent a évoqué des sanctions contre les entreprises chinoises pratiquant ce type d’extraction.
Ces déclarations restent des accusations : Moonshot ne les a ni confirmées ni démenties, et Nvidia n’a pas répondu aux sollicitations de CNBC.
L’ambassade de Chine au Royaume-Uni avait auparavant qualifié ce type de mise en cause d’accusations sans fondement.
Retenez surtout le calendrier : quatre jours entre la sortie du modèle et la riposte politique.
La réponse américaine n’est pas venue d’un laboratoire, elle est venue de la Maison-Blanche.
Deux modèles de risque opposés, un seul choix à faire
Les deux camps ne défendent pas la même idée de la sécurité.
Côté américain, le contrôle se fait à la source : classificateurs de sécurité, paliers d’accès restreints, filtrage par nationalité en cas de directive.
Le programme Glasswing d’Anthropic illustre bien cette logique d’accès sélectif.
Côté chinois, la diffusion maximale sert de stratégie industrielle, une fois publiés, les poids échappent à tout le monde, y compris à l’éditeur.
Vous ne choisissez donc pas entre un modèle sûr et un modèle risqué, vous choisissez le risque que vous acceptez de porter : l’indisponibilité soudaine, ou l’absence totale de rappel possible.
Ce que ça change pour vos déploiements dès maintenant ?
Trois décisions concrètes découlent de cette situation.
- Abstraire votre couche modèle. Un client API compatible OpenAI et une variable d’environnement suffisent souvent à basculer d’un fournisseur à l’autre. Ce qui s’est passé en Juin a montré que ce travail se paie en 24 heures.
- Documenter un plan de repli par cas d’usage. Un agent de support et un pipeline de génération de code n’ont pas la même tolérance à une coupure de trois semaines.
- Attendre le texte de licence avant tout engagement. Aucun déploiement K3 en production tant que le fichier de licence n’est pas publié et lu par votre juridique.
Sur le budget, l’écart de prix reste le vrai argument commercial de Moonshot.
Trois dollars contre dix en entrée, quinze contre cinquante en sortie : le facteur est proche de trois pour une équivalence similaire et même de meilleurs résultats pour Kimi K3 sur certains benchmarks comme celui dédié au frontend design.
Attention toutefois : K3 reste le plus cher des grands modèles ouverts, très loin devant DeepSeek V4 Pro sur le coût par tâche.
Si votre seul critère est le coût, regardez d’abord le comparatif des LLM les plus rentables et la dernière version de DeepSeek.
Notre verdict :
Kimi K3 n’est pas encore le meilleur modèle du marché, et Moonshot l’admet. Mais il déplace la question : la performance se rattrape en six mois, la souveraineté d’accès ne se rattrape pas. Tant que les poids ne sont pas publiés et la licence lisible, traitez K3 comme un fournisseur API de plus, pas comme une porte de sortie.

Fondateur de LEPTIDIGITAL et SUPASST, je suis également consultant spécialisé en acquisition de leads B2B (SaaS). Passionné par le marketing digital, l’intelligence artificielle et le SEO. Avant de devenir indépendant, j’ai occupé des postes clés en tant que SEO Manager et responsable e-commerce pour plusieurs grandes entreprises (Altice Media, Infopro Digital, Voyage Privé et le Groupe ERAM). Sur le plan perso, je suis un curieux insatiable, également passionné par la photographie, le badminton et les voyages. Pour toute demande de partenariat, privilégiez LinkedIn ou email ([email protected]).