Kimi K32.8T
开放的前沿智能

Moonshot AI 的旗舰开源模型——1M-token 上下文窗口、原生视觉理解、长程推理能力,并采用面向编码、智能体与知识工作的架构打造。

什么是 Kimi K3?

Kimi K3 是 Moonshot AI 迄今为止能力最强的旗舰模型。它拥有 2.8 万亿参数,是全球首个达到 3 万亿参数级别的开源模型。其架构融合了 Kimi Delta Attention、Attention Residuals、Stable LatentMoE 以及原生多模态理解能力。

该模型面向前沿智能场景,而非短促、孤立的提示词。它被设计为在长时间工程会话、大规模研究语料、截图、图片、视频、终端工具,以及需要规划与反复修订的知识工作流中,依然保持高效表现。

对于正在对比先进开源模型的读者而言,Kimi K3 凭借更大规模、1M-token 上下文窗口、原生视觉能力,以及更强的智能体取向脱颖而出。

2.8T 参数

前沿级开源模型,将 Moonshot AI 的探索从万亿参数级进一步推进。

1M-token 上下文

专为超大代码库、海量文档、研究档案与持续的智能体历史记录而设计。

原生视觉理解

在编码、研究、创意与工具驱动的工作流中,将截图、图片与视频纳入理解与处理。

Kimi K3 适合谁

当任务更长、更偏多模态、更技术化或知识密度更高,并且需要模型在不确定性中持续推进,而不是只给出一个短答案时,Kimi K3 的价值最为突出。

01

工程团队

面向软件工程师、基础设施团队与技术负责人,支持长程编码与仓库级工作——大仓库导航、终端与工具编排,以及实现过程中的视觉反馈。

02

研究与分析团队

面向分析师、咨询顾问与科研人员的重证据型知识工作——多文档综合、从研究到代码的工作流,并在 1M-token 上下文内完成报告、仪表盘与可视化。

03

创意与技术团队

为将工程与图片、视频、截图结合的团队提供“原生视觉”闭环——视觉迭代与调试、动效与交互工作,以及跨视觉与技术领域的快速原型。

首个达到 2.8T 参数的开源模型

Kimi K3 代表开源模型前沿的一次跃迁——在 12 个月内从 Kimi K2 的 1T 参数提升至 2.8T,并成为首个跻身 3 万亿参数级别的开放权重模型。

首个达到 2.8T 参数的开源模型

Kimi K3 如何在大规模下传递信息

K3 的架构在提升序列长度与模型深度上的信息流动效率的同时,依然保持稀疏专家计算的高效性。Kimi Delta Attention(KDA)是一种可扩展到长序列的混合线性注意力机制;Attention Residuals 会从更早的模块中选择性检索表征;Stable LatentMoE 则会为每个 token 在 896 个专家中高效激活其中 16 个——三者协同,使其扩展效率约为 Kimi K2 的 2.5×。

Kimi K3 如何在大规模下传递信息

Kimi K3 模型常见问题

  • Kimi K3 是 Moonshot AI 的 2.8 万亿参数旗舰开源模型,面向长程编码、推理、原生视觉理解与端到端知识工作而设计。