Dunia kecerdasan buatan kembali memanas dalam sepekan terakhir. Tiga pengembangan besar hadir nyaris bersamaan: model terbaru xAI, Grok 4.7; model open-source Xiaomi, MiMo-V2.6; serta klaim terobosan matematika dari model internal OpenAI. Ketiganya menandai babak baru persaingan AI yang semakin ketat, baik dari sisi performa, harga, maupun keterbukaan model.

Grok 4.7: Peningkatan Bertahap dengan Harga Sama

xAI merilis Grok 4.7 sebagai pembaruan dari Grok 4.6. Perusahaan mempertahankan harga dan kecepatan yang sama seperti versi sebelumnya, yakni 2 dolar AS per satu juta token masukan dan 6 dolar AS per satu juta token keluaran, dengan jendela konteks hingga 500 ribu token.

Pada indeks kecerdasan Artificial Analysis, Grok 4.7 mencatat skor 46. Angka itu masih tertinggal dari Claude Fable 5.1 dan GPT-6 Astra yang mencetak skor 53. Sejumlah skor internal yang dipublikasikan mencakup CursorBench 4.0 sebesar 46,3 persen, DeepSWE 71 persen, Terminal-Bench 38 persen, dan EEBench 66 persen.

Meski begitu, sejumlah pengamat mencatat Grok 4.7 cenderung "malas" dan kerap mengambil jalan pintas, terutama di luar skenario benchmark resmi. Catatan ini menjadi bahan evaluasi tersendiri bagi pengguna yang mengandalkan model tersebut untuk tugas-tugas kompleks.

MiMo-V2.6: Model Open-Source Xiaomi yang Menantang

Xiaomi meluncurkan MiMo-V2.6 dalam dua varian, Pro dan Flash, dengan lisensi MIT yang membuatnya dapat diakses secara terbuka. MiMo-V2.6-Pro disebut sebagai model open-weight terkuat saat ini dengan skor 46, setara dengan Grok 4.7.

Yang menarik, harga MiMo-V2.6 jauh lebih murah, yakni 0,435 dolar AS untuk masukan dan 0,87 dolar AS untuk keluaran per satu juta token. Model ini juga mendukung konteks hingga satu juta token serta kemampuan multimodal. Xiaomi turut menyiapkan varian MiMo-V2.6-Pro-UltraSpeed untuk kebutuhan yang menuntut kecepatan lebih tinggi.

Model Internal OpenAI dan Klaim 100 Masalah Matematika

Dari kubu OpenAI, sebuah model internal yang mulai dilatih pada 28 Agustus diklaim mampu menyelesaikan lebih dari 100 masalah matematika terbuka. Salah satu yang paling disorot adalah persoalan Navier–Stokes, yang termasuk dalam daftar Millennium Prize Problems.

Untuk memperkuat kredibilitas temuan tersebut, OpenAI membentuk kelompok penasihat matematika independen. Langkah ini dinilai penting mengingat klaim semacam itu memerlukan verifikasi ketat dari komunitas akademik sebelum dianggap sebagai capaian yang mapan.

Persaingan AI Semakin Ketat

Kemunculan ketiga perkembangan ini menunjukkan lanskap AI bergerak cepat. Di satu sisi, model komersial seperti Grok 4.7 terus mengoptimalkan performa dan efisiensi biaya. Di sisi lain, model open-source seperti MiMo-V2.6 menawarkan alternatif yang lebih terjangkau tanpa mengorbankan kemampuan. Sementara itu, klaim terobosan matematika OpenAI membuka diskusi soal sejauh mana AI dapat berkontribusi pada pemecahan masalah ilmiah mendasar.

Bagi pengguna dan pelaku industri, pilihan model kini tak lagi sekadar soal skor tertinggi, melainkan juga soal harga, keterbukaan, dan kesesuaian dengan kebutuhan. Persaingan yang sehat ini diperkirakan akan terus mendorong inovasi di sektor kecerdasan buatan dalam beberapa bulan mendatang.