xAI merilis "Grok 4.7", versi baru model andalannya, pada 21 September 2026. Perusahaan menyebutnya sebagai model paling mumpuni yang pernah mereka buat untuk pemrograman dan pekerjaan berbasis pengetahuan (knowledge work).
Peningkatan utama
Menurut pengumuman resmi, Grok 4.7 menggunakan model dasar baru yang lebih besar daripada Grok 4.6. Selain itu, model ini menjalani reinforcement learning lebih lama dari sebelumnya, dengan data pelatihan yang memuat banyak tugas sulit yang butuh berjam-jam untuk diselesaikan.
Menurut xAI, hasilnya terlihat pada peningkatan berikut:
- Mampu mengerjakan tugas sulit dalam waktu lebih lama
- Memeriksa hasil kerjanya sendiri dengan lebih teliti
- Lebih baik dalam menangani konteks panjang
- Lebih piawai membuat dokumen dan slide presentasi
Angka-angka utama
Berikut angka-angka utama yang diumumkan xAI:
- 46,3% di "CursorBench 4.0", benchmark pemrograman (Grok 4.6: 40,4%)
- 71,0% di "DeepSWE v1.1", benchmark pengembangan perangkat lunak (Grok 4.6: 65,2%)
- 19,6% di "Harvey Legal Agent Benchmark", benchmark pekerjaan hukum (Grok 4.6: 15,8%)
- 56,7% di "HealthBench Professional", benchmark penalaran klinis (Grok 4.6: 48,5%)
Dari sisi keamanan, Grok 4.7 dilengkapi perlindungan yang dibangun ulang, dan xAI menyebutnya sebagai model dengan kemampuan menolak permintaan yang tidak pantas serta ketahanan terhadap jailbreak terkuat di antara model yang pernah mereka uji. Seluruh angka tersebut berasal dari pengumuman xAI sendiri.
Harga dan ketersediaan
Harga API per 1 juta token mulai dari US$2 untuk input dan US$6 untuk output. Tersedia juga versi cepat dengan kecepatan output dua kali lipat, dengan harga dua kali lipat versi standar.
Grok 4.7 dapat digunakan di Cursor, alat pengembang milik xAI "Grok Build", dan Grok API, serta melalui alat pemrograman, model router, dan layanan cloud pihak ketiga.
Pandangan Redaksi CoAI
Pengumuman ini jelas menyasar pengembang dan penggunaan untuk pekerjaan. Langkah xAI menghadirkan Grok 4.7 di Cursor sejak hari peluncuran juga menunjukkan ambisinya untuk dipilih dalam pekerjaan pemrograman. Saat membandingkannya dengan model-model besar lain, selain harga, ada baiknya juga memeriksa hasil benchmark yang paling mendekati kebutuhan Anda.