Olympic.or.id – Dunia kecerdasan buatan kembali berguncang. xAI, perusahaan AI milik Elon Musk yang kini bertransformasi menjadi SpaceXAI, secara resmi melepas model terbaru mereka, Grok 4.6, untuk publik pada Rabu (12/8/2026) waktu setempat. Peluncuran ini bukan sekadar rilis biasa, melainkan sebuah deklarasi perang teknologi yang langsung menyita perhatian para pelaku industri.
Yang paling menarik perhatian, Grok 4.6 berhasil menyalip performa Kimi K3, model open-weight buatan Moonshot asal China, dalam sejumlah pengujian penting. Bahkan, pencapaiannya lebih mengejutkan lagi ketika model ini berhasil menyamai performa GPT-5.6 Sol milik OpenAI di indeks benchmark independen bergengsi, Artificial Analysis Intelligence Index. Ini menjadi titik balik yang menunjukkan bahwa perlombaan AI makin panas dan tak terduga.
Skor Melesat, Pesaing Mulai Ketar-ketir
Menurut data terbaru dari Artificial Analysis, Grok 4.6 mencetak skor 61 di Intelligence Index mereka. Skor ini tidak hanya menyamai GPT-5.6 Sol Max milik OpenAI, tetapi juga melampaui Kimi K3 yang hanya meraih skor 60. Meskipun begitu, Grok 4.6 masih harus mengakui keunggulan dua model dari Anthropic. Claude Opus 5 masih kokoh di puncak dengan skor 63, sementara Claude Fable 5 menyusul di angka 62. Artinya, meski sudah naik kelas, Grok 4.6 masih punya pekerjaan rumah besar untuk mengejar para pemimpin pasar.
Yang mencengangkan, skor 61 ini naik lima poin dibandingkan Grok 4.5 High, versi sebelumnya yang hanya mendapatkan 56. Kenaikan ini terbilang signifikan, mengingat jeda waktu peluncuran antara kedua versi hanya sekitar satu bulan. Artinya, tim xAI bekerja sangat cepat dan agresif dalam mengoptimalkan model mereka, tanpa memberi kesempatan pesaing untuk menarik napas.
Artificial Analysis Intelligence Index sendiri bukanlah sekadar angka. Ini adalah skor gabungan dari sembilan benchmark berbeda, termasuk GDPval-AA v2, Terminal-Bench v2.1, GPQA Diamond, dan Humanity’s Last Exam. Karena itu, indeks ini menjadi salah satu acuan paling terpercaya di industri untuk membandingkan kemampuan model-model AI kelas atas. Jadi, kenaikan skor ini benar-benar mencerminkan peningkatan kemampuan nyata.
Agen Cerdas dan Efisiensi Gila-gilaan
Lalu, apa sebenarnya kekuatan utama Grok 4.6 yang membuatnya melonjak tajam? Jawabannya ada pada kemampuan agentik, yaitu kemampuannya menjalankan tugas panjang secara mandiri dan efisien. Ini bukan sekadar peningkatan kecil, melainkan lompatan besar yang membuatnya sangat kompetitif untuk urusan otomatisasi kerja.
Di benchmark GDPval-AA v2 yang mengukur pekerjaan pengetahuan dunia nyata, Grok 4.6 mencatat skor Elo 1.753. Angka ini hanya kalah dari Claude Opus 5, sehingga menempatkan Grok 4.6 di posisi kedua terbaik. Fakta ini membuktikan bahwa Grok 4.6 kini menjadi salah satu model paling cerdas dalam menyelesaikan masalah kompleks yang biasa ditemui di kantor-kantor modern.
Yang lebih menarik lagi, Grok 4.6 terbukti jauh lebih efisien daripada pesaingnya. Model ini hanya membutuhkan sekitar 53 langkah untuk menyelesaikan tugas yang sama, sementara Claude Opus 5 memerlukan hingga 103 langkah. Ini berarti Grok 4.6 tidak hanya pintar, tetapi juga lincah dan hemat energi komputasi, sehingga bisa menghemat waktu dan biaya operasional bagi pengguna bisnis.
Di benchmark τ³-Banking, Grok 4.6 juga menunjukkan taringnya dengan mencetak skor 50,7 persen, termasuk dua skor tertinggi bersama Qwen3.8 Max. Sementara di Terminal-Bench v2.1, skornya mencapai 88,4 persen, sejajar dengan model-model kelas atas lainnya. Artinya, Grok 4.6 sudah bisa diandalkan di berbagai skenario penggunaan, mulai dari perbankan hingga terminal coding.
Harga Tetap Murah, Strategi Jitu Rebut Pasar
Selain performa, strategi harga menjadi senjata utama Grok 4.6 untuk merebut pasar korporasi. Harga standar API Grok 4.6 dibanderol 2 dolar AS per juta token input dan 6 dolar AS per juta token output. Kalau dikonversi, sekitar Rp36.000 per juta token input dan Rp108.000 per juta token output. Ini tergolong murah untuk ukuran model frontier.
Yang menarik, harga ini sebenarnya tidak berubah sama sekali dari Grok 4.5. Artinya, xAI berhasil memberikan kenaikan performa signifikan tanpa menaikkan harga. Ini jelas menjadi nilai jual tambahan yang sulit ditolak oleh perusahaan-perusahaan yang ingin mengadopsi AI canggih tanpa menguras kantong.
Dengan strategi harga ini, Grok 4.6 menjadi salah satu model kelas frontier dengan harga menengah, jika dibandingkan dengan pesaing-pesaingnya baik yang tertutup maupun open source. Ini membuatnya sangat kompetitif, terutama bagi startup dan perusahaan menengah yang ingin merasakan teknologi AI terbaik tanpa merogoh kocek terlalu dalam.
Elon Musk, CEO xAI, tidak menyia-nyiakan kesempatan untuk membanggakan diri lewat platform X yang juga dia miliki. “Objektif nomor satu kalau mempertimbangkan kecerdasan, kecepatan, dan biaya,” klaim Musk soal Grok 4.6. Namun, klaim ini terdengar agak berlebihan mengingat kebanggaan terbesar dalam pengumuman resminya adalah Grok 4.6 hanya menyamai, bukan mengalahkan, GPT-5.6 Sol. Tapi siapa yang bisa menyalahkan Musk? Dia memang terkenal sebagai master of hype.
Lalu, apa yang mendorong kebangkitan Grok di papan atas benchmark AI ini? Jawabannya ada pada akuisisi strategis. SpaceXAI mengakuisisi perusahaan coding agentic, Cursor, senilai sekitar 60 miliar dolar AS (sekitar Rp1.080 triliun), tak lama sebelum SpaceX melantai di bursa saham. Akuisisi ini terbukti menjadi kunci lonjakan performa Grok.
Grok 4.5 sebelumnya menjadi versi pertama model xAI yang dilatih memakai sebagian data penggunaan nyata yang dikumpulkan Cursor. Sedangkan Grok 4.6 disebut menjalani proses pelatihan tambahan yang bahkan lebih lama dari pendahulunya. Dengan data nyata dari Cursor, Grok mendapatkan pengalaman praktis yang tidak bisa diperoleh dari data sintetis biasa.
Grok 4.6 akan tersedia lebih dulu di Cursor, berbarengan dengan agen coding milik xAI, Grok Build, mulai hari peluncurannya. Integrasi ini memungkinkan para pengembang untuk langsung merasakan kemampuan Grok 4.6 dalam membantu pekerjaan coding mereka. Ini langkah cerdas untuk membangun ekosistem yang kuat.
Cursor dan xAI juga memperkenalkan agen AI yang berjalan terus-menerus bernama Grok Bot, yang sudah dirilis dalam versi beta pekan ini. Grok Bot dirancang untuk menjadi asisten digital yang selalu siap sedia 24/7. Ini jelas mengancam keberadaan asisten virtual lainnya yang masih bekerja dengan cara konvensional.
Namun, meski kembali bersaing di papan atas performa AI global, reputasi Grok di ranah bisnis masih tertinggal jauh dari para kompetitornya. Sebelumnya, model ini sempat menuai kontroversi besar karena dipakai secara masif untuk menghasilkan gambar tidak senonoh tanpa izin, termasuk yang melibatkan anak-anak, sehingga membuat sejumlah lembaga pemerintah AS ragu mengadopsinya.
Menurut data AI Index dari Ramp, hanya 4 persen perusahaan pengguna AI yang memilih berlangganan produk xAI. Angka ini jauh tertinggal dibandingkan pesaing-pesaingnya. Ini adalah tantangan besar yang harus segera diatasi oleh xAI jika ingin benar-benar menjadi pemain utama di pasar enterprise.
Meskipun begitu, peluncuran Grok 4.6 tetap menjadi sinyal kuat bahwa Elon Musk serius dalam perlombaan AI. Dengan kombinasi performa, harga, dan efisiensi, Grok 4.6 adalah penantang berat bagi OpenAI dan Anthropic. Pertanyaannya sekarang, mampukah Grok 4.6 mempertahankan momentum ini dan mengejar ketertinggalan di pasar bisnis? Waktu yang akan menjawab.
Temukan juga berbagai berita terbaru lainnya hanya di Exposenews.id.









