Kimi K32.8T
開放式前沿智慧

Moonshot AI 的旗艦開源模型——支援 1M-token 上下文視窗、原生視覺理解與長週期推理,並以專為程式開發、Agent 與知識工作打造的架構為核心。

什麼是 Kimi K3?

Kimi K3 是 Moonshot AI 迄今最強大的旗艦模型。它擁有 2.8 兆參數,是全球首個達到 3 兆參數級別的開源模型。其架構結合 Kimi Delta Attention、Attention Residuals、Stable LatentMoE,以及原生多模態理解能力。

這個模型面向的是前沿智慧應用場景,而非短小、零散的提示詞。它的設計目標是在長時間的工程工作階段、大型研究語料、截圖、圖片、影片、終端機工具,以及需要規劃與反覆修訂的知識工作流程中,依然能維持高效表現。

對於正在比較進階開源模型的讀者而言,Kimi K3 以其規模、1M-token 上下文視窗、原生視覺能力,以及強烈的 Agent 導向而格外突出。

2.8T 參數

前沿規模的開源模型,將 Moonshot AI 的能力推進到兆級參數之外的新境界。

1M-token 上下文

專為大型程式碼庫、文件、研究檔案與長期 Agent 歷程的持續工作而設計。

原生視覺理解

可將截圖、圖片與影片納入程式開發、研究、創作與工具驅動的工作流程中進行處理。

Kimi K3 適合誰

當任務需要長時間投入、牽涉多模態、技術門檻高或知識密度極高時,Kimi K3 的價值最能發揮——尤其是模型必須在不確定中持續推進,而不是只回傳一句簡短答案的情境。

01

工程團隊

適合軟體工程師、基礎架構團隊與技術主管進行長週期程式開發與倉庫級工作——包含大型程式庫導覽、終端機與工具協調,以及實作過程中的視覺回饋。

02

研究與分析團隊

適合分析師、顧問與科學家處理高度依賴證據的知識工作——多文件整合、從研究到程式開發的工作流,以及在 1M-token 上下文中完成報告、儀表板與視覺化成果。

03

創意與技術團隊

適合將工程與圖片、影片、截圖結合的團隊,讓原生視覺能力全程參與——視覺迭代與除錯、動態與互動設計,以及跨視覺與技術領域的快速原型開發。

首個達到 2.8T 參數的開源模型

Kimi K3 代表開源模型前沿的一次大幅躍進——在 12 個月內從 Kimi K2 的 1T 參數提升到 2.8T,並成為首個達到 3 兆參數級別的開放權重模型。

首個達到 2.8T 參數的開源模型

Kimi K3 如何在大規模下傳遞資訊

K3 的架構在提升序列長度與模型深度之間的資訊流動同時,也能維持稀疏專家運算的效率。Kimi Delta Attention(KDA)是一種混合式線性注意力機制,用於長序列擴展;Attention Residuals 會選擇性地從較早的區塊取回表徵;Stable LatentMoE 則在每個 token 上從 896 位專家中高效啟用其中 16 位——三者合力,使其擴展效率約為 Kimi K2 的 2.5 倍。

Kimi K3 如何在大規模下傳遞資訊

Kimi K3 模型常見問題

  • Kimi K3 是 Moonshot AI 的 2.8 兆參數旗艦開源模型,專為長週期程式開發、推理、原生視覺理解,以及端到端的知識工作打造。