Monday, 31 August 2026 | Mise à jour quotidienne L'intelligence artificielle au service des constructeurs

Kimi K3

Kimi K3 — Spécifications

Rédigé par Mustafa Ihsan d’après la documentation officielle du fournisseur · Dernière mise à jour

Développeur Moonshot AI
Type LLM (architecture MoE, raisonnement, multimodal)
Modalité Texte, vision → texte
Paramètres 2,8 T au total / 16 experts actifs sur 896 (MoE)
Fenêtre de contexte 1 million
Licence Poids ouverts (prévu le 2026-07-27)
Poids ouverts Oui
Publié 2026-07
Prix de l’entrée $3.00 /1M
Prix de la sortie $15.00 /1M
Fournisseurs d'API Moonshot (Kimi), OpenRouter

Exécutez-le localement

VRAM (4 bits) ~1,4 To
GPU minimal Cluster multi-nœuds (par ex. 2 × nœuds H200 à 8 GPU, 141 Go chacun)

Page officielle →

Qu'est-ce que Kimi K3 ?

Kimi K3 est le modèle de pointe ouvert de Moonshot AI, doté de 2,8 billions de paramètres — une architecture mélange d’experts
qui active uniquement 16 des 896 experts par jeton, avec une fenêtre de contexte de 1 million de jetons, une prise en charge native
de la vision et un raisonnement permanent. Il obtient un score de 57 sur l’Artificial Analysis Intelligence Index,
dépassant légèrement Claude Opus 4.8 (56) et ne cédant que devant GPT-5.6 Sol (59) et Claude Fable 5 (60)
— le meilleur résultat open-weight jamais enregistré à ce jour. Les poids ont été publiés le 27 juillet 2026.

L’importance réside dans l’écart, ou plutôt dans son absence. Le fait qu’un modèle open-weight se situe
à seulement trois points du meilleur modèle fermé du marché élimine le dernier argument commode
justifiant des prix élevés au motif exclusif des performances. À 3 $ en entrée / 15 $ en sortie par
million de jetons, K3 coûte également deux fois moins cher que GPT-5.5 en coût combiné, tout en obtenant un score supérieur. La difficulté réside
dans l’exploitation : environ 1,4 To de VRAM en quantification 4 bits nécessitent un cluster multi-nœuds — deux nœuds H200 à 8 GPU de 141 Go
ou équivalent — ainsi, « ouvert » signifie ici vérifiable et portable entre fournisseurs, pas exécutable
dans votre salle serveur. Pour presque tous les utilisateurs, K3 constitue une décision d’utilisation via API qui s’accompagne toutefois
d’une voie de sortie.

Kimi K3 — Tarifs API par million de jetons

Entrée (par million de jetons)$3.00
Sortie (par million de jetons)$15.00
Ratio sortie/entrée
Moyenne pondérée (4:1 entrée:sortie)$5.40 par 1 million de jetons

Coût mensuel de Kimi K3

Dépense mensuelle réelle pour un ratio entrée-sortie de 4:1 — le rapport effectivement observé dans une charge de travail type (chat ou RAG).

Charge de travailJetons/moisCoût par mois
Projet secondaire 1 million en entrée / 0,25 million en sortie $6.75
Petite équipe 20 millions en entrée / 5 millions en sortie $135
Production 200 millions en entrée / 50 millions en sortie $1,350

Calculez vos propres coûts dans le Calculateur de coûts pour les API IA.

Des alternatives moins chères à Kimi K3

ModèleCoût combiné par million de dollarsVous économisez
GLM 5.2 ouverte $2.00 63 % moins cher
Gemini 3.5 Flash $3.00 44 % moins cher
Gemini 3.1 Pro $4.00 26 % moins cher

Hébergement local ou paiement via API ?

Kimi K3 est un modèle open-weight, vous pouvez donc l’exécuter localement. Il nécessite ~1,4 To environ 1,4 To de VRAM en quantification 4 bits (cluster multi-nœuds, p. ex. deux nœuds H200 à 8 GPU de 141 Go). L’hébergement local n’est rentable calculateur auto-hébergement vs API calcule le seuil de rentabilité pour votre volume de jetons.

Questions fréquemment posées

Combien coûte Kimi K3 par million de jetons ?

Kimi K3 coûte 3,00 $ par million de jetons d’entrée et 15,00 $ par million de jetons de sortie. Avec un ratio typique entrée/sortie de 4:1, le coût combiné s’élève à environ 5,40 $ par million de jetons.

Combien coûte Kimi K3 par mois ?

Une charge de travail modeste (20 millions de jetons d’entrée et 5 millions de jetons de sortie par mois) coûte environ 135 $ sur Kimi K3. Un projet secondaire (1 million d’entrées / 0,25 million de sorties) coûte environ 6,75 $.

Quelle est une alternative moins chère à Kimi K3 ?

GLM 5.2 est l’option la plus performante et la moins chère de notre base de données, à 2,00 $ par million de jetons combinés — soit environ 63 % de moins que Kimi K3. Il est également open-weight, ce qui permet aussi un hébergement local.

Puis-je exécuter Kimi K3 localement ?

Oui. Kimi K3 est un modèle open-weight et nécessite environ 1,4 To de VRAM en quantification 4 bits (cluster multi-nœuds, p. ex. deux nœuds H200 à 8 GPU de 141 Go).

Pourquoi Kimi K3 facture-t-il davantage les jetons de sortie que ceux d’entrée ?

Les jetons de sortie sont générés un par un et ne peuvent pas être traités par lots comme un prompt, ce qui augmente leur coût d’exploitation pour le fournisseur. Kimi K3 facture 5 fois plus les jetons de sortie, ce qui explique pourquoi les charges de travail axées sur les prompts sont nettement moins coûteuses que celles axées sur la génération.

Les prix indiqués correspondent aux tarifs publics officiels pour l’API principale du modèle et sont mis à jour régulièrement à mesure que les fournisseurs les modifient. Les remises liées aux volumes, aux traitements par lots ou aux entrées mises en cache ne sont pas prises en compte. Comparez tous les modèles côte à côte dans le Base de données des modèles IA ou le Classement des grands modèles linguistiques (LLM).

Défiler vers le haut
Featured on There's An AI For That