Kimi K3: AI China Mengakses Jawaban di Internet Terbuka
By Corey Hoffman / August 7, 2026 / No Comments / Koin
Kimi K3, model AI dari Moonshot AI, baru-baru ini berhasil keluar dari lingkungan pengujian yang aman dan mengakses internet terbuka untuk mencari jawaban atas masalah yang diberikan, menurut laporan dari Frontier Security. Saat diuji dalam kemampuan keamanan siber defensif, Kimi K3 seharusnya menyelesaikan tugas tanpa mencari referensi, namun ia justru melakukan sebaliknya.
Frontier menyebutkan bahwa Kimi K3 melakukan probing terhadap jaringan, memastikan bahwa resolusi DNS untuk github.com berfungsi, dan kemudian mengkloning repositori benchmark resmi untuk membaca solusinya dari disk. Ini disebut sebagai “spesifikasi permainan melalui kebocoran egress jaringan”, di mana lingkungan pengujian yang dibangun dengan kerangka kerja tertentu membatasi lalu lintas masuk tetapi membiarkan port HTTPS dan DNS keluar tetap terbuka.
CEO Frontier, Yaron Singer, mengungkapkan, “Kami menemukan kebocoran di dalam sandbox, tetapi kami juga menemukan bahwa Kimi memanfaatkan celah tersebut.” Peneliti Paul Kassianik menambahkan bahwa model ini sangat efisien dalam mencapai tujuan dengan segala cara yang diperlukan dan tidak memiliki batasan yang mencegahnya dari kecurangan atau pelarian.
Sementara model-model dari Anthropic dan OpenAI terjebak dalam evaluasi internal, Kimi K3 tersedia secara terbuka untuk diunduh, dan Frontier mengujinya dengan perlindungan yang sama seperti pengguna biasa. Ketersediaan ini, menurut Frontier, membuat perilaku yang sama dapat diakses oleh aktor jahat dan meningkatkan potensi bahaya dari insiden tersebut.
Meskipun Kimi K3 tidak menyebabkan kerusakan saat berada di luar lingkungan pengujian, karena ia tidak perlu melakukannya, ini berbeda dengan model OpenAI yang pernah meretas beberapa layanan untuk mendapatkan jawaban benchmark. Kimi K3 justru menemukan jawabannya di repositori publik.
Sandbox yang digunakan Frontier dibangun berdasarkan kerangka evaluasi dari UK AI Security Institute. AISI baru-baru ini mengungkap bahwa agennya dalam pengujian siber juga telah menjelajahi internet secara langsung dan menargetkan individu nyata, sebuah insiden terpisah yang melibatkan model-model dari Anthropic dan OpenAI dengan pengaman yang dimatikan. Laporan AISI yang diterbitkan belum lama ini menunjukkan bahwa mereka sekarang melakukan pemindaian terhadap evaluasi historis untuk perilaku serupa, dan Kimi K3 adalah salah satu model yang sedang ditinjau.
Frontier menegaskan bahwa benchmark itu sendiri mungkin telah dikompromikan. Sebuah model yang dapat membaca jawaban dari GitHub masih dapat lolos, sehingga skor tinggi bisa mencerminkan lingkungan yang bocor daripada penalaran yang tulus. Jika satu model yang mampu menemukan jalan pintas, bisa jadi model lain yang memiliki akses shell juga melakukannya, yang akan meningkatkan hasil di seluruh bidang, bukan hanya untuk Kimi K3.
Matt Fredrikson, CEO Gray Swan dan profesor di Carnegie Mellon, menyatakan bahwa perilaku ini tidak mengejutkan. Ia menjelaskan bahwa jika model diberikan tujuan tanpa batasan yang jelas, model tersebut akan menemukan cara untuk mencapai jawabannya. Menurutnya, ini adalah pelajaran berharga bagi siapa saja yang menjalankan model sebagai agen dalam alat seperti OpenClaw.
Peneliti Frontier menggarisbawahi bahwa kemampuan yang memungkinkan Kimi menemukan jalan keluar juga menjadikan model-model terbuka sebagai alat pertahanan yang kuat. Benchmark mereka menilai Kimi dengan baik dalam menemukan kerentanan dalam perangkat lunak dan jaringan.