Kimi K32.8T
开放的前沿智能

Moonshot AI 的旗舰开源模型——拥有 1M-token 上下文窗口、原生视觉理解、长跨度推理,以及为编程、智能体与知识工作打造的架构。

什么是 Kimi K3?

Kimi K3 是 Moonshot AI 迄今能力最强的旗舰模型。它拥有 2.8 万亿参数,是全球首个达到 3 万亿参数级别的开源模型。其架构融合了 Kimi Delta Attention、Attention Residuals、Stable LatentMoE,以及原生多模态理解。

该模型面向前沿智能场景,而非短促、孤立的提示词。它被设计为在长时间工程会话、大型研究语料库、截图、图片、视频、终端工具,以及需要规划与反复修订的知识工作流中依然保持高效。

对于正在对比先进开源模型的读者来说,Kimi K3 以更大的规模、1M-token 上下文窗口、原生视觉能力,以及强智能体导向脱颖而出。

2.8T 参数

前沿级开源模型,将 Moonshot AI 的探索从万亿参数时代进一步推向更高规模。

1M-token 上下文

专为超大代码库、文档、研究档案与长期智能体历史的连续工作而设计。

原生视觉理解

可将截图、图片与视频纳入编程、研究、创作与工具驱动的工作流中进行处理与推理。

Kimi K3 适合谁

当任务周期长、涉及多模态、技术性强或知识密度高时,Kimi K3 的价值最为突出——尤其是在模型需要在不确定性中持续推进,而不是只给出一个简短答案的情况下。

01

工程团队

面向软件工程师、基础设施团队与技术负责人,支持长跨度编程与仓库级工作——大仓库导航、终端与工具编排,以及实现过程中的可视化反馈。

02

研究与分析团队

面向分析师、顾问与科学家的证据密集型知识工作——多文档综合、从研究到代码的工作流,以及在 1M-token 上下文中完成报告、仪表板与可视化。

03

创意与技术团队

为将工程与图片、视频、截图结合的团队提供“原生视觉”闭环——视觉迭代与调试、运动与交互工作,以及跨视觉与技术领域的快速原型开发。

首个达到 2.8T 参数的开源模型

Kimi K3 标志着开源模型前沿的显著跃升——从 Kimi K2 的 1T 参数在 12 个月内提升到 2.8T,并成为首个进入 3 万亿参数级别的开放权重模型。

首个达到 2.8T 参数的开源模型

Kimi K3 如何在大规模下传递信息

K3 的架构在提升序列长度与模型深度下的信息流动性的同时,仍能保持稀疏专家计算的高效率。Kimi Delta Attention(KDA)是一种可在长序列上扩展的混合线性注意力机制;Attention Residuals 会选择性地从更早的模块检索表征;Stable LatentMoE 则会为每个 token 在 896 位专家中高效激活其中 16 位——三者协同,使其规模扩展效率约为 Kimi K2 的 2.5×。

Kimi K3 如何在大规模下传递信息

Kimi K3 模型常见问题

  • Kimi K3 是 Moonshot AI 的 2.8 万亿参数旗舰开源模型,专为长跨度编程、推理、原生视觉理解与端到端知识工作打造。