Kimi K3 muncul sebagai salah satu rilisan AI yang paling menyita perhatian karena menggabungkan tiga hal yang jarang hadir bersamaan: ukuran model yang sangat besar, bobot yang dibuka ke publik, dan orientasi kuat pada tugas agentic seperti coding, penggunaan tools, serta pemrosesan konteks sangat panjang. Moonshot AI memosisikannya sebagai model open-weight, multimodal, dan agentic dengan total sekitar 2,8 triliun parameter, 104 miliar parameter aktif per token, serta context window hingga 1.048.576 token [1][2]. Di atas kertas, ini menempatkan Kimi K3 di wilayah yang sebelumnya lebih banyak dikuasai model frontier tertutup.
Namun, pembahasan tentang Kimi K3 hampir tidak pernah berhenti pada spesifikasinya saja. Model ini juga berada di tengah kontroversi serius setelah Anthropic menuduh Moonshot melakukan distillation berskala besar terhadap Claude melalui jutaan interaksi yang diperoleh secara tidak sah [3]. Reuters kemudian melaporkan bahwa pejabat Amerika Serikat mengaitkan tuduhan itu secara lebih spesifik dengan pengembangan Kimi K3, termasuk klaim bahwa Claude Fable 5 digunakan untuk membantu membangun model tersebut [4].
Pertanyaan besarnya lalu menjadi sangat tajam: apakah Kimi K3 merupakan inovasi asli dari Moonshot, atau hanya versi tiruan dari Claude? Jawaban paling hati-hati dan objektif, berdasarkan informasi publik yang tersedia per 30 Juli 2026, adalah bahwa belum ada bukti publik yang cukup untuk menyebut Kimi K3 sebagai salinan Claude. Akan tetapi, ada tuduhan resmi yang rinci dan serius bahwa Moonshot menggunakan keluaran Claude untuk distillation secara sistematis, dan tuduhan itu relevan langsung terhadap keluarga model Kimi [3][4]. Dengan kata lain, menyebut Kimi K3 sekadar “rip-off” terlalu menyederhanakan masalah, tetapi mengabaikan kontroversi tersebut juga tidak jujur secara faktual.
Apa sebenarnya Kimi K3?
Menurut model card resmi Moonshot, Kimi K3 adalah model open-weight, native multimodal, dan agentic. Karakteristik intinya meliputi 2,8 triliun total parameter, 104 miliar parameter aktif, arsitektur Mixture-of-Experts, 93 layer, 896 experts dengan 16 expert aktif per token, context window 1.048.576 token, serta vision encoder MoonViT-V2 sekitar 401 juta parameter [2]. Technical report arXiv Moonshot juga menegaskan posisi Kimi K3 sebagai model frontier open-weight pada skala mendekati tiga triliun parameter [1]. Fakta ini penting karena menunjukkan bahwa Kimi K3 bukan sekadar antarmuka yang membungkus API model lain. Moonshot memang merilis bobot modelnya sendiri, sekaligus memublikasikan ringkasan arsitektur dan klaim teknis terkait.
Dari sisi penggunaan, Kimi K3 dirancang untuk pekerjaan panjang yang menuntut memori konteks luas dan koordinasi tindakan bertahap. Itu mencakup pembacaan repositori kode besar, modifikasi banyak file, pemanggilan tools, pencarian informasi, pemrosesan dokumen visual, sampai penyelesaian alur kerja yang berlangsung ratusan langkah [1][2]. Konteks satu juta token memberi ruang bagi model untuk memuat dokumen panjang, histori agent, dan banyak artefak kerja sekaligus. Meski demikian, ukuran context window tidak otomatis berarti seluruh isi konteks akan dipahami secara sempurna. Dalam praktik, susunan prompt, relevansi dokumen, manajemen tool, dan cara aplikasi mengelola histori tetap sangat menentukan kualitas keluaran. Ini adalah analisis teknis yang masuk akal, bukan klaim unik dari Moonshot.
Mengapa Kimi K3 dianggap menarik dari sisi teknik?
Nilai utama Kimi K3 bukan hanya pada angka parameter, melainkan pada kombinasi desain sparse dan efisiensi pemrosesan urutan panjang. Moonshot menyebut penggunaan Mixture-of-Experts untuk memungkinkan total parameter sangat besar tanpa harus mengaktifkan semuanya pada setiap token [1][2]. Secara sederhana, model memiliki banyak kelompok parameter khusus, tetapi hanya sebagian yang dipilih ketika memproses token tertentu. Pendekatan seperti ini membuat skala total model bisa melambung tinggi, sementara biaya komputasi aktif tetap lebih rendah daripada model dense dengan ukuran total setara.
Technical report dan model card juga menyoroti komponen seperti Kimi Delta Attention, Attention Residuals, dan MoonViT-V2 [1][2]. Kimi Delta Attention diposisikan sebagai mekanisme untuk menangani konteks panjang secara lebih efisien daripada menerapkan full attention mahal di seluruh lapisan. Attention Residuals diklaim membantu aliran informasi pada model yang sangat dalam, sementara MoonViT-V2 menjadi fondasi pemrosesan visual. Walau pembaca tetap perlu bersikap kritis terhadap klaim performa dari pembuat model, keberadaan komponen arsitektural yang dinamai, dijelaskan, dan dikaitkan ke sistem bobot yang benar-benar dirilis menunjukkan adanya pekerjaan riset dan engineering nyata dari Moonshot [1][2].
Hal ini penting dalam menjawab tuduhan peniruan. Jika pertanyaannya adalah apakah Kimi K3 sekadar salinan bobot atau shell kosong di atas model lain, fakta publik justru mengarah ke sebaliknya. Moonshot membuka bobot, menjelaskan arsitektur tingkat tinggi, dan memosisikan Kimi K3 sebagai sistem yang mereka latih sendiri [1][2]. Itu tidak otomatis membebaskan mereka dari tuduhan distillation, tetapi cukup untuk mengatakan bahwa pembahasan tentang Kimi K3 harus dibedakan antara orisinalitas arsitektur dan asal-usul sebagian data pengajaran atau teacher outputs.
Bagaimana performa Kimi K3 menurut sumber resminya?
Moonshot mempublikasikan sejumlah hasil benchmark yang menempatkan Kimi K3 sangat tinggi pada beberapa pengujian. Model card resminya mencantumkan antara lain GPQA Diamond 93,5, Terminal-Bench 2.1 sebesar 88,3, BrowseComp 91,2, FrontierSWE 81,2, SWE-Marathon 42,0, dan OmniDocBench 91,1 [2]. Angka-angka ini memperkuat citra Kimi K3 sebagai model yang sangat kuat untuk reasoning, coding, browsing, dan pekerjaan berbasis dokumen. Technical report juga menyatakan Kimi K3 mampu mengungguli berbagai model open dan proprietary dalam suite evaluasi mereka [1].
Namun, ada catatan penting yang justru membuat analisis menjadi lebih seimbang. Moonshot sendiri mengakui dalam paper bahwa performa keseluruhan Kimi K3 masih tertinggal dari Claude Fable 5 dan GPT-5.6 Sol [1]. Ini relevan karena menunjukkan framing yang lebih hati-hati daripada promosi pemasaran biasa. Jadi, Kimi K3 bukan model yang menurut Moonshot sudah menaklukkan semua pesaing tertutup. Ia lebih tepat dipahami sebagai model open-weight yang sangat agresif mengejar kelas frontier, dengan beberapa keunggulan menonjol pada tugas tertentu, tetapi belum secara total melampaui model proprietary terbaik [1][2].
Selain itu, benchmark resmi tetap harus dibaca dengan kehati-hatian metodologis. Hasil yang diumumkan pengembang belum sama dengan audit independen. Konfigurasi reasoning effort, agent harness, tool use, prompt, fallback, dan cara konteks diatur dapat mengubah skor secara signifikan. Karena itu, benchmark Kimi K3 berguna sebagai indikasi kemampuan, tetapi belum cukup sebagai vonis final tentang posisi model di semua skenario nyata. Ini adalah batasan analitis yang penting, terutama saat artikel membahas topik yang mudah terpolarisasi seperti tuduhan meniru pesaing.
Lalu, di mana letak kontroversinya?
Kontroversi utama bukan bermula dari kesamaan gaya jawaban atau kesamaan fitur produk, melainkan dari tuduhan distillation attacks. Dalam pernyataan resmi pada 23 Februari 2026, Anthropic mengatakan mereka mengidentifikasi kampanye distillation berskala industri oleh beberapa pihak, termasuk Moonshot [3]. Untuk Moonshot secara spesifik, Anthropic menyebut ada lebih dari 3,4 juta exchanges dengan Claude melalui banyak akun curang. Mereka menyatakan aktivitas tersebut menargetkan agentic reasoning and tool use, coding and data analysis, computer-use agent development, dan computer vision [3].
Anthropic juga menjelaskan bahwa atribusi itu, menurut mereka, dibuat berdasarkan korelasi alamat IP, request metadata, infrastructure indicators, dan dalam beberapa kasus dukungan dari partner industri [3]. Ini membuat tuduhan tersebut jauh lebih konkret daripada kritik umum seperti “model lain pasti meniru model Amerika.” Tuduhan Anthropic tidak berhenti pada spekulasi perilaku model, tetapi menyebut skala interaksi, jenis kemampuan yang diambil, dan indikator teknis atribusi [3].
Reuters lalu menambahkan lapisan baru yang lebih sensitif secara geopolitik. Dalam laporannya pada 27 Juli 2026, Reuters menulis bahwa Direktur OSTP Gedung Putih, Michael Kratsios, mengatakan pemerintah AS memiliki informasi bahwa Moonshot melakukan distillation terhadap Claude Fable 5 untuk mengembangkan Kimi K3 [4]. Laporan yang sama menyebut Moonshot membantah tuduhan tersebut dan mengatakan peningkatan performa Kimi K3 berasal dari perubahan orisinal pada arsitektur dasar [4]. Reuters juga menghubungkan pernyataan itu dengan tuduhan Anthropic sebelumnya mengenai lebih dari 3,4 juta interaksi Claude yang dikaitkan ke Moonshot [4].
Jika diringkas, rantai klaim publiknya terlihat seperti ini: pertama, Moonshot merilis model open-weight yang sangat besar dan ambisius [1][2]; kedua, Anthropic menuduh Moonshot melakukan pengambilan keluaran Claude secara tidak sah dalam skala industri [3]; ketiga, pejabat AS mengaitkan tuduhan itu secara spesifik dengan pengembangan Kimi K3 [4]; keempat, Moonshot menyangkal bahwa lompatan performanya berasal dari distillation Claude dan menekankan inovasi arsitekturalnya sendiri [4].
Apakah itu berarti Kimi K3 adalah salinan Claude?
Tidak sesederhana itu. Untuk menjawabnya secara objektif, perlu dibedakan setidaknya tiga level dugaan peniruan.
- Pertama, salinan bobot. Tidak ada bukti publik yang menunjukkan bahwa bobot Kimi K3 adalah salinan langsung bobot Claude. Kimi K3 tersedia sebagai open-weight, sedangkan tidak ada artefak publik dari Claude yang memungkinkan pembandingan parameter-ke-parameter. Jadi, klaim bahwa tensor atau checkpoint Kimi K3 berasal langsung dari Claude belum dapat dibuktikan dari materi publik [1][2][3][4].
- Kedua, salinan arsitektur. Tidak ada cukup informasi publik untuk menyimpulkan bahwa arsitektur Kimi K3 menyalin Claude. Justru yang tersedia adalah technical report dan model card Moonshot yang menjelaskan MoE, Kimi Delta Attention, Attention Residuals, dan MoonViT-V2 [1][2]. Karena arsitektur internal Claude tidak dibuka penuh, tuduhan “arsitekturnya sama” tidak dapat diverifikasi secara terbuka.
- Ketiga, penggunaan keluaran Claude untuk distillation. Inilah tuduhan paling serius dan paling spesifik. Anthropic secara resmi menuduh Moonshot melakukan distillation tidak sah melalui jutaan interaksi Claude [3], dan Reuters melaporkan bahwa pejabat AS mengaitkannya dengan pengembangan Kimi K3 [4].
Dari ketiga level itu, hanya level ketiga yang saat ini punya tuduhan publik rinci. Tetapi bahkan di titik itu pun, publik belum memperoleh audit terbuka yang dapat memverifikasi secara independen seluruh rantai bukti. Artinya, kesimpulan yang bertanggung jawab bukan “Kimi K3 terbukti menjiplak Claude,” melainkan “Kimi K3 berada di bawah tuduhan serius telah memanfaatkan keluaran Claude secara tidak sah sebagai teacher data” [3][4].
Mengapa perbedaan ini penting?
Karena distillation tidak sama dengan cloning. Dalam distillation, model teacher menghasilkan jawaban, contoh, jejak pemikiran, penilaian, atau keluaran lain yang kemudian dipakai untuk meningkatkan model student. Student tidak harus memiliki bobot, ukuran, atau arsitektur yang sama dengan teacher. Ia bisa sangat berbeda, tetapi tetap menyerap sebagian pola kemampuan atau preferensi jawaban dari teacher. Maka, sebuah model bisa sekaligus memiliki inovasi arsitektur asli dan tetap mendapat manfaat dari keluaran model lain dalam post-training. Kedua hal ini tidak saling meniadakan.
Itulah sebabnya perdebatan tentang Kimi K3 sering menjadi kabur. Sebagian pihak melihat bobot terbuka, arsitektur rinci, dan performa tinggi lalu menyimpulkan model ini pasti murni inovasi internal. Sebagian lain melihat tuduhan Anthropic dan langsung menyebutnya salinan Claude. Kedua sikap itu terlalu ekstrem jika hanya didasarkan pada bukti publik saat ini. Fakta yang tersedia mendukung dua kesimpulan parsial sekaligus: Moonshot tampaknya memang melakukan pekerjaan riset dan engineering sendiri [1][2], tetapi Moonshot juga menghadapi tuduhan kredibel dan spesifik terkait distillation tidak sah terhadap Claude [3][4].
Apakah kemiripan gaya jawaban bisa dijadikan bukti?
Tidak cukup. Dalam industri AI modern, banyak model dapat terlihat mirip karena dilatih untuk preferensi manusia yang serupa, mengonsumsi data instruction-following yang tumpang tindih, atau dioptimalkan untuk tool use, coding, dan agentic reasoning dengan pola yang secara fungsional mendekat. Kompatibilitas API, kemiripan gaya penjelasan, atau kecenderungan menyusun jawaban dengan struktur tertentu bukan bukti kuat bahwa satu model adalah salinan model lain. Kesamaan seperti itu bisa muncul dari banyak penyebab yang sah maupun tidak sah. Karena itu, tuduhan serius seperti yang diarahkan ke Moonshot harus bertumpu pada indikator teknis, data akses, dan audit provenance, bukan sekadar impresi gaya bahasa.
Apakah technical report Kimi K3 mengakui penggunaan distillation?
Technical report memang membahas teknik pelatihan lanjutan dan penguatan agentic pada skala sangat besar [1]. Dalam konteks pengembangan model modern, penggunaan teacher policies atau bentuk distillation internal bukan hal aneh. Namun, dari sumber yang dirujuk di sini, tidak ada pernyataan dalam report atau model card yang menyatakan bahwa Claude digunakan sebagai teacher resmi [1][2]. Jadi, keberadaan istilah atau metode distillation dalam dokumen teknis Moonshot tidak boleh otomatis dibaca sebagai pengakuan bahwa teacher-nya adalah Claude. Itu lompatan logika yang tidak didukung teks sumber.
Pada saat yang sama, Moonshot juga tidak memublikasikan provenance audit lengkap yang memungkinkan pihak luar menelusuri seluruh sumber data post-training, seluruh teacher outputs, atau seluruh asal interaksi yang dipakai selama pengembangan [1][2]. Keterbatasan transparansi inilah yang membuat pihak luar juga belum dapat membantah tuduhan Anthropic secara tuntas. Jadi, ada dua kekosongan yang sama-sama penting: tidak ada bukti publik final untuk menyatakan Kimi K3 sebagai salinan Claude, tetapi juga tidak ada audit publik komprehensif untuk membersihkan semua kecurigaan.
Sejauh mana Kimi K3 tetap layak dianggap inovasi?
Jika ukuran inovasi dinilai dari apa yang dipublikasikan Moonshot sendiri, Kimi K3 layak diperhatikan sebagai capaian engineering yang substansial. Bobot model dirilis secara terbuka, arsitektur dijelaskan pada tingkat yang berarti, dan sistemnya dirancang untuk multimodalitas, tool use, serta million-token agentic RL [1][2]. Bahkan tanpa menerima semua klaim performa secara mentah, keberanian Moonshot membawa model open-weight ke skala 2,8 triliun parameter tetap merupakan langkah besar dalam ekosistem AI. Ini memperluas akses komunitas terhadap kelas model yang sebelumnya lebih identik dengan pemain tertutup.
Selain itu, posisi Kimi K3 sebagai model agentic juga penting secara industri. Banyak organisasi kini tidak lagi hanya mencari chatbot yang pandai menjawab, melainkan model yang bisa membaca repo, menjalankan tools, memeriksa hasil, lalu mengulangi proses sampai tugas selesai. Dalam lanskap seperti itu, context window sangat besar, multimodalitas, dan desain sparse yang efisien menjadi nilai praktis, bukan sekadar angka marketing. Kimi K3 memanfaatkan momentum itu dengan menawarkan sesuatu yang secara teknis ambisius dan secara distribusi lebih terbuka dibanding pesaing frontier tertutup [1][2].
Namun, apa risiko membaca Kimi K3 terlalu positif?
Risiko utamanya adalah menutup mata terhadap aspek legal, etis, dan tata kelola. Jika tuduhan distillation Anthropic terbukti benar di kemudian hari, implikasinya bukan hanya reputasional, tetapi juga menyangkut kepatuhan, lisensi, rantai asal data, dan model risk management [3][4]. Perusahaan yang mengadopsi model seperti Kimi K3, terutama di sektor teregulasi atau yang menangani data sensitif, perlu mempertimbangkan bahwa kualitas teknis model tidak otomatis memutus semua risiko hukum dan tata kelola di sekitarnya.
Di sisi lain, ada juga risiko kebalikannya: menolak semua model terbuka dari perusahaan tertentu hanya karena tuduhan yang belum dibuktikan secara publik di pengadilan atau audit independen. Sikap seperti ini bisa membuat analisis teknologi jatuh ke politik identitas, bukan evaluasi bukti. Pendekatan yang lebih sehat adalah memisahkan dua lapisan penilaian: apakah modelnya secara teknis berguna, dan apakah rantai pengembangannya menghadirkan risiko legal atau etis yang harus dipertimbangkan. Dalam kasus Kimi K3, jawaban atas pertanyaan pertama cenderung positif menurut data resmi [1][2], sementara jawaban atas pertanyaan kedua adalah: risikonya nyata dan belum terselesaikan [3][4].
Jadi, apa kesimpulan objektifnya?
Berdasarkan sumber primer Moonshot, Kimi K3 jelas menunjukkan pekerjaan riset dan engineering asli pada level arsitektur yang dipublikasikan, bobot yang dirilis, dan desain sistem yang memang dibangun untuk multimodalitas, tool use, dan konteks satu juta token [1][2]. Berdasarkan pernyataan resmi Anthropic dan laporan Reuters, Moonshot juga menghadapi tuduhan serius bahwa mereka melakukan distillation tidak sah terhadap Claude dalam skala industri, dan tuduhan itu dikaitkan secara spesifik dengan pengembangan Kimi K3 [3][4].
Karena belum ada bukti forensik publik final, putusan pengadilan, atau audit independen terbuka yang membuktikan penyalinan langsung, menyebut Kimi K3 sebagai “salinan Claude” masih melampaui bukti yang tersedia [3][4]. Tetapi menyebut kontroversi itu sebagai gosip kosong juga tidak akurat, karena tuduhannya rinci, terstruktur, dan datang dari pihak yang mengklaim memiliki indikator teknis atribusi [3].
Maka, formulasi yang paling aman secara editorial adalah ini: Kimi K3 tampaknya merupakan model dengan arsitektur dan engineering asli dari Moonshot AI, tetapi tetap dibayangi tuduhan serius bahwa sebagian kemampuannya diperoleh melalui distillation tidak sah dari Claude [1][2][3][4]. Dua hal tersebut bisa benar pada saat yang sama.
Bagi developer, Kimi K3 tetap menarik karena menawarkan kombinasi langka: skala sangat besar, bobot terbuka, multimodalitas, dan orientasi agentic yang kuat [1][2]. Bagi perusahaan, keputusan mengadopsinya sebaiknya tidak hanya didasarkan pada benchmark, melainkan juga pada uji internal, evaluasi keamanan, kepatuhan lisensi, pengelolaan data sensitif, dan pemantauan risiko hukum yang mungkin berkembang seiring waktu. Pada akhirnya, debat tentang Kimi K3 bukan cuma soal siapa paling pintar di benchmark, melainkan juga soal bagaimana industri AI akan mendefinisikan batas antara inovasi, inspirasi, dan ekstraksi kemampuan pesaing di era model frontier.
Sumber:
[1] Kimi K3: Open Frontier Intelligence (arXiv)
[2] moonshotai/Kimi-K3 README model card (Hugging Face)
[3] Detecting and preventing distillation attacks (Anthropic)
[4] Reuters: laporan terkait tuduhan terhadap Moonshot AI dan Kimi K3