Kimi K32.8T
L’intelligence de frontière en open source

Le modèle ouvert phare de Moonshot AI — une fenêtre de contexte de 1M tokens, une compréhension visuelle native, un raisonnement sur le long terme et une architecture conçue pour le codage, les agents et le travail de connaissance.

Qu’est-ce que Kimi K3 ?

Kimi K3 est le modèle phare le plus puissant de Moonshot AI à ce jour. Avec 2.8 billions de paramètres, c’est le tout premier modèle open source au monde dans la classe des 3 billions de paramètres. Son architecture combine Kimi Delta Attention, Attention Residuals, Stable LatentMoE et une compréhension multimodale native.

Le modèle vise des scénarios d’intelligence de frontière plutôt que des prompts courts et isolés. Il est conçu pour rester performant lors de longues sessions d’ingénierie, sur de grands corpus de recherche, des captures d’écran, des images, des vidéos, des outils en terminal et des flux de travail de connaissance qui exigent planification et révision.

Pour celles et ceux qui comparent des modèles ouverts avancés, Kimi K3 se démarque par son échelle, sa fenêtre de contexte de 1M tokens, sa vision native et une orientation fortement « agentique ».

2.8T paramètres

Un modèle ouvert à l’échelle de la frontière, qui prolonge l’ambition de Moonshot AI au-delà du seuil du billion de paramètres.

Contexte de 1M tokens

Conçu pour travailler sur de vastes bases de code, des documents, des archives de recherche et des historiques d’agents de longue durée.

Compréhension visuelle native

Traite les captures d’écran, les images et la vidéo dans des flux de travail de codage, de recherche, créatifs et pilotés par des outils.

À qui s’adresse Kimi K3

Kimi K3 est le plus utile quand une tâche est longue, multimodale, technique ou dense en connaissances — et quand le modèle doit avancer malgré l’ambiguïté plutôt que de renvoyer une seule réponse courte.

01

Équipes d’ingénierie

Codage sur le long terme et travail à l’échelle du dépôt pour les ingénieurs logiciel, les équipes infrastructure et les responsables techniques — navigation dans de grands dépôts, orchestration du terminal et des outils, et retours visuels pendant l’implémentation.

02

Équipes de recherche et d’analyse

Travail de connaissance fondé sur des preuves pour les analystes, consultants et scientifiques — synthèse multi-documents, flux de travail de la recherche au code, et rapports, tableaux de bord et visualisations dans un contexte de 1M tokens.

03

Équipes créatives et techniques

Vision native intégrée au flux de travail pour les équipes qui combinent ingénierie, images, vidéo et captures d’écran — itération visuelle et débogage, travail du mouvement et des interactions, et prototypage rapide entre domaines visuels et techniques.

Le premier modèle ouvert à 2.8T paramètres

Kimi K3 marque une expansion majeure de la frontière des modèles ouverts — de 1T paramètres pour Kimi K2 à 2.8T en douze mois, et le premier modèle à poids ouverts à atteindre la classe des 3 billions de paramètres.

Le premier modèle ouvert à 2.8T paramètres

Comment Kimi K3 fait circuler l’information à grande échelle

L’architecture de K3 améliore la circulation de l’information sur la longueur de séquence et la profondeur du modèle, tout en gardant un calcul parcimonieux par experts efficace. Kimi Delta Attention (KDA) est un mécanisme d’attention linéaire hybride conçu pour monter en charge sur de longues séquences ; Attention Residuals récupère de manière sélective des représentations depuis des blocs précédents ; et Stable LatentMoE active 16 des 896 experts par token — l’ensemble atteignant environ 2.5× l’efficacité de mise à l’échelle de Kimi K2.

Comment Kimi K3 fait circuler l’information à grande échelle

FAQ sur le modèle Kimi K3

  • Kimi K3 est le modèle ouvert phare de Moonshot AI à 2.8 billions de paramètres, conçu pour le codage sur le long terme, le raisonnement, la compréhension visuelle native et le travail de connaissance de bout en bout.