AI China Kalahkan GPT-4: Startup Ini Ciptakan Terobosan!

JogloNesia – Dunia kecerdasan buatan (AI) kembali dihebohkan dengan kehadiran inovasi terbaru dari Moonshot AI, sebuah startup AI terkemuka asal China. Perusahaan ini secara resmi meluncurkan model bahasa open source teranyarnya, Kimi K2, yang diklaim memiliki performa superior, khususnya dalam pengkodean (coding) dan pengembangan agen AI.

Advertisements

Dalam sebuah pengumuman di blog perusahaan, Moonshot AI menegaskan bahwa kemampuan Kimi K2 melampaui model AI sejenis dari raksasa teknologi seperti OpenAI maupun Anthropic. “Kimi K2 tidak hanya sekadar menjawab, ia bertindak,” ungkap Moonshot AI, menyoroti bagaimana model ini membuka akses ke kecerdasan agen AI tingkat lanjut yang jauh lebih mudah dijangkau dan powerful dari sebelumnya.

Baca juga: China Buat OS AI Baru, Bisa Ingat dan Belajar seperti Manusia

Kimi K2 dibekali dengan total satu triliun parameter, namun berkat arsitektur Mixture-of-Experts (MoE), hanya 32 miliar parameter yang aktif dalam setiap operasi. Teknik inovatif ini memungkinkan model AI memiliki kapasitas komputasi yang masif tanpa memerlukan daya yang sangat besar, menjadikannya efisien sekaligus sangat kuat.

Advertisements

Salah satu keunggulan utama dari model AI revolusioner ini adalah kemampuannya dalam menggunakan alat secara otonom, menulis serta mengeksekusi kode, hingga menyelesaikan berbagai tugas kompleks tanpa memerlukan campur tangan manusia. Fitur ini menempatkan Kimi K2 sebagai pionir dalam otonomi AI.

Performa luar biasa Kimi K2 terbukti dalam serangkaian pengujian benchmark terkemuka. Pada AI SWE-benc Verified, sebuah tolok ukur yang mengukur kemampuan model AI dalam menyelesaikan masalah perangkat lunak di dunia nyata, seperti perbaikan bug, Kimi K2 mencapai akurasi impresif sebesar 65,8 persen. Angka ini jauh mengungguli GPT-4.1 dari OpenAI yang mencatat 54,6 persen, serta DeepSeek V3-0324 dengan 38,8 persen.

Dominasi Kimi K2 juga terlihat dalam pengujian coding di platform LiveCodeBench, di mana ia meraih akurasi 53,7 persen. Skor ini melampaui DeepSeek-V3 (46,9 persen), GPT 4.1 (44,7 persen), serta Claude 4 Opus dari Anthropic (47,4 persen), menegaskan keunggulannya dalam aplikasi pengkodean.

Baca juga: China Tanam Chip di Otak Manusia seperti Amerika

Tidak hanya itu, pada benchmark MATH-500 yang menguji kemampuan model AI dalam memecahkan soal matematika tingkat lanjut, Kimi K2 mencetak skor 97,4 persen. Angka ini lebih tinggi dari GPT-4.1 yang meraih 92,4 persen. Skor fantastis tersebut menunjukkan bahwa Kimi K2 mampu mengatasi soal matematika yang bahkan belum bisa dipecahkan oleh model AI lainnya, demikian dilaporkan KompasTekno dari Venture Beat pada Selasa (15/7/2025).

Kimi K2 tersedia dalam dua versi: model dasar yang ditujukan bagi peneliti dan pengembang, serta varian yang dapat dikustomisasi secara khusus untuk mengakomodasi aplikasi chatbot dan agen AI yang lebih kompleks. Model ini dibanderol dengan harga kompetitif, yaitu 0,15 dollar AS (sekitar Rp 2.442) per satu juta token input dan 2,25 dollar AS (sekitar Rp 36.644) per sejuta token output, menjadikan teknologi canggih ini lebih mudah diakses oleh beragam inovator.

Ringkasan

Moonshot AI, sebuah startup AI terkemuka dari China, telah meluncurkan model bahasa open source terbarunya, Kimi K2. Model ini diklaim memiliki performa superior, terutama dalam pengkodean dan pengembangan agen AI. Kimi K2 dikembangkan dengan arsitektur Mixture-of-Experts (MoE) yang inovatif, memungkinkan kapasitas komputasi masif dengan efisiensi daya.

Keunggulan Kimi K2 dibuktikan melalui serangkaian pengujian benchmark terkemuka, mengungguli model dari OpenAI dan Anthropic. Dalam AI SWE-benc Verified, Kimi K2 mencapai akurasi 65,8 persen, melampaui GPT-4.1. Selain itu, model ini menunjukkan dominasi dalam pengujian coding di LiveCodeBench dan memecahkan soal matematika tingkat lanjut di MATH-500. Kimi K2 juga menonjol karena kemampuannya dalam menggunakan alat secara otonom dan menyelesaikan tugas kompleks tanpa intervensi manusia.

Advertisements