Kimi K32.8T
Kecerdasan Frontier Terbuka

Model terbuka utama Moonshot AI — tetingkap konteks 1M token, pemahaman visual natif, penaakulan jangka panjang, dan seni bina yang dibina untuk pengekodan, ejen, serta kerja pengetahuan.

Apakah Kimi K3?

Kimi K3 ialah model utama Moonshot AI yang paling berkeupayaan setakat ini. Dengan 2.8 trilion parameter, ia merupakan model sumber terbuka pertama di dunia dalam kelas 3-trilion-parameter. Seni binanya menggabungkan Kimi Delta Attention, Attention Residuals, Stable LatentMoE, dan pemahaman multimodal natif.

Model ini menyasarkan senario kecerdasan frontier, bukannya prompt yang pendek dan terasing. Ia direka untuk kekal berkesan merentas sesi kejuruteraan jangka panjang, korpus penyelidikan yang besar, tangkapan skrin, imej, video, alat terminal, serta aliran kerja pengetahuan yang memerlukan perancangan dan semakan.

Bagi pembaca yang membandingkan model terbuka lanjutan, Kimi K3 menonjol melalui skalanya, tetingkap konteks 1M token, vision natif, dan orientasi yang sangat berfokuskan ejen.

2.8T parameter

Model terbuka berskala frontier yang melanjutkan usaha Moonshot AI melangkaui rejim trilion-parameter.

Konteks 1M token

Direka untuk berfungsi merentas codebase yang luas, dokumen, arkib penyelidikan, dan sejarah ejen yang berterusan.

Pemahaman visual natif

Memproses tangkapan skrin, imej, dan video sebagai sebahagian daripada aliran kerja pengekodan, penyelidikan, kreatif, dan dipacu alat.

Siapa yang sesuai menggunakan Kimi K3

Kimi K3 paling bernilai apabila tugasan adalah panjang, multimodal, teknikal, atau sarat pengetahuan — dan apabila model perlu terus berfungsi dalam situasi yang samar, bukannya sekadar memberi satu jawapan ringkas.

01

Pasukan kejuruteraan

Pengekodan jangka panjang dan kerja berskala repositori untuk jurutera perisian, pasukan infrastruktur, dan ketua teknikal — navigasi repositori besar, orkestrasi terminal dan alat, serta maklum balas visual semasa pelaksanaan.

02

Pasukan penyelidikan & analisis

Kerja pengetahuan berasaskan bukti yang padat untuk penganalisis, perunding, dan saintis — sintesis pelbagai dokumen, aliran kerja penyelidikan-ke-kod, serta laporan, papan pemuka, dan visualisasi merentas konteks 1M token.

03

Pasukan kreatif & teknikal

Vision natif dalam gelung untuk pasukan yang menggabungkan kejuruteraan dengan imej, video, dan tangkapan skrin — iterasi visual dan nyahpepijat, kerja gerakan dan interaksi, serta prototaip pantas merentas domain visual dan teknikal.

Model terbuka pertama pada 2.8T parameter

Kimi K3 menandakan peluasan besar sempadan model terbuka — daripada 1T parameter Kimi K2 kepada 2.8T dalam tempoh dua belas bulan, serta model open-weight pertama yang mencapai kelas 3-trilion-parameter.

Model terbuka pertama pada 2.8T parameter

Bagaimana Kimi K3 mengalirkan maklumat pada skala besar

Seni bina K3 meningkatkan aliran maklumat merentas panjang jujukan dan kedalaman model sambil mengekalkan pengiraan pakar jarang (sparse) yang cekap. Kimi Delta Attention (KDA) ialah mekanisme perhatian linear hibrid untuk penskalaan merentas jujukan panjang; Attention Residuals mengambil semula perwakilan daripada blok terdahulu secara terpilih; dan Stable LatentMoE mengaktifkan 16 daripada 896 pakar bagi setiap token — secara keseluruhan mencapai kira-kira 2.5× kecekapan penskalaan Kimi K2.

Bagaimana Kimi K3 mengalirkan maklumat pada skala besar

Soalan Lazim model Kimi K3

  • Kimi K3 ialah model terbuka utama Moonshot AI dengan 2.8 trilion parameter, direka untuk pengekodan jangka panjang, penaakulan, pemahaman visual natif, dan kerja pengetahuan hujung-ke-hujung.