Grok 4.7 Resmi Rilis! AI Coding yang Bisa Kerja Berjam-jam Nonstop

Grok 4.7 Resmi Rilis! AI Coding yang Bisa Kerja Berjam-jam Nonstop

Grok 4.7 Resmi Rilis! AI Coding yang Bisa Kerja Berjam-jam Nonstop

Perusahaan kecerdasan buatan SpaceXAI resmi merilis model AI terbaru mereka yang dinamai Grok 4.7 pada pekan ini. Model AI suksesor Grok 4.6 tersebut disebut-sebut sebagai terobosan besar dalam dunia coding dan pekerjaan kompleks, karena kemampuannya mengerjakan tugas berat berjam-jam tanpa henti.


Yang lebih menarik, Grok 4.7 juga diklaim mampu memeriksa kembali hasil pekerjaannya secara mandiri, sebuah kemampuan yang selama ini menjadi kelemahan utama model AI generasi sebelumnya. Dengan fitur ini, Grok 4.7 tidak hanya menjadi asisten coding biasa, tetapi bisa menjadi mitra kerja yang andal untuk proyek-proyek jangka panjang.


Reinforcement Learning: Rahasia di Balik Kemampuan Grok 4.7

SpaceXAI mengungkapkan bahwa kemampuan Grok 4.7 dalam mengerjakan tugas coding kompleks tidak lepas dari metode pelatihan yang digunakan. Model ini dilatih dengan reinforcement learning dalam durasi yang lebih panjang dan dengan materi yang lebih banyak serta kompleks.


Apa itu reinforcement learning?


Reinforcement learning adalah teknik pelatihan AI di mana model diberikan penilaian (reward) terhadap hasil yang dibuatnya. Tujuannya adalah agar model tersebut dapat belajar menghasilkan respons yang lebih baik dari waktu ke waktu. Semakin banyak dan kompleks materi pelatihan, semakin canggih pula kemampuan model tersebut.


Pendekatan inilah yang membuat Grok 4.7 jauh lebih unggul dalam menangani:


  • Tugas dengan banyak tahapan: Grok 4.7 tidak mudah "lelah" atau kehilangan konteks saat mengerjakan tugas yang terdiri dari puluhan langkah.
  • Konteks panjang: Model ini mampu memahami dan mengingat informasi dalam jumlah besar, sehingga cocok untuk proyek coding dengan kode yang panjang dan rumit.
  • Pekerjaan yang membutuhkan verifikasi: Grok 4.7 dapat memeriksa kembali hasil kerjanya sendiri, mengurangi kesalahan yang sering terjadi pada model AI sebelumnya.


Peningkatan Performa: Skor Benchmark Grok 4.7 Naik Drastis

Untuk membuktikan klaimnya, SpaceXAI merilis sejumlah data benchmark yang menunjukkan peningkatan signifikan Grok 4.7 dibandingkan Grok 4.6. Berikut rinciannya:


BenchmarkGrok 4.6Grok 4.7Peningkatan
CursorBench 4.040,4%46,3%+5,9%
DeepSWE v1.1 (high effort)65,2%71%+5,8%
Terminal-Bench 4.020,3%38%+17,7%
EEBench53%64%+11%
Harvey Legal Agent Benchmark15,8%19,6%+3,8%
HealthBench Professional48,5%56,7%+8,2%


Peningkatan paling mencolok terlihat pada Terminal-Bench 4.0, di mana Grok 4.7 mencatat skor 38 persen, hampir dua kali lipat dari Grok 4.6 yang hanya 20,3 persen. Ini menunjukkan kemampuan Grok 4.7 dalam berinteraksi dengan konsol terminal/command line, yang sangat penting bagi para developer dan system administrator.

Sementara itu, pada DeepSWE v1.1 dengan konfigurasi high effort, Grok 4.7 berhasil meraih skor 71 persen, meningkat dari 65,2 persen pada Grok 4.6. Angka ini menegaskan bahwa Grok 4.7 memang dirancang untuk menyelesaikan tugas-tugas software engineering yang kompleks.


Harga Grok 4.7: Tetap Sama, Tapi Token Bisa Lebih Boros

Meskipun performanya meningkat drastis, SpaceXAI memutuskan untuk tidak menaikkan harga Grok 4.7. Model ini dibanderol dengan harga yang sama persis seperti Grok 4.6:


  • Input token: $2 USD (sekitar Rp35.700) per 1 juta token
  • Output token: $6 USD (sekitar Rp107.000) per 1 juta token


Namun, ada catatan penting: SpaceXAI menyebut bahwa penggunaan token Grok 4.7 dalam tugas tertentu akan jauh lebih tinggi dari model sebelumnya. Data dari Artificial Analysis yang dihimpun blog teknologi WCCFTech menunjukkan bahwa:


  • Grok 4.7 (konfigurasi xhigh): Menggunakan sekitar 81.000 output token per tugas dalam Intelligence Index.
  • Grok 4.6 (konfigurasi high): Menggunakan sekitar 36.000 token.


Artinya, meskipun harga per token sama, biaya penggunaan Grok 4.7 dalam praktik bisa lebih tinggi karena model ini membutuhkan lebih banyak token untuk menyelesaikan suatu pekerjaan. Ini adalah trade-off yang wajar mengingat kompleksitas tugas yang mampu ditangani.


Varian Grok 4.7 Fast: Lebih Cepat, Lebih Mahal

Selain Grok 4.7 versi biasa, SpaceXAI juga menyediakan varian Grok 4.7 Fast. Varian ini memiliki kecepatan keluaran sekitar dua kali lebih tinggi dibandingkan versi standar. Namun, tarifnya juga dua kali lipat dari harga normal.


Varian Fast ini cocok untuk pengguna yang membutuhkan respons cepat dalam jumlah besar, seperti aplikasi real-time atau layanan pelanggan berbasis AI.


Ketersediaan Grok 4.7: Di Mana Bisa Diakses?

Grok 4.7 sudah tersedia melalui berbagai platform, antara lain:


  • Grok Build: Platform pengembangan resmi dari SpaceXAI.
  • Cursor: Editor kode populer yang mengintegrasikan AI.
  • Grok API: Untuk developer yang ingin membangun aplikasi di atas Grok 4.7.
  • Platform coding harness pihak ketiga: Berbagai alat pengembangan yang mendukung integrasi Grok.
  • Model router dan platform cloud: Layanan cloud yang menyediakan akses ke Grok 4.7.


Dengan ketersediaan yang luas ini, para developer dan perusahaan dapat dengan mudah mengintegrasikan Grok 4.7 ke dalam alur kerja mereka.


Analisis: Apa Arti Grok 4.7 bagi Industri AI?

Peluncuran Grok 4.7 menandai beberapa tren penting dalam industri AI:


  • Fokus pada Tugas Kompleks: Model AI tidak lagi hanya sekadar menjawab pertanyaan sederhana, tetapi mulai diarahkan untuk menyelesaikan pekerjaan yang membutuhkan penalaran mendalam dan multitahap.
  • Otonomi yang Meningkat: Kemampuan Grok 4.7 untuk memeriksa kembali hasil kerjanya sendiri adalah langkah menuju AI yang lebih mandiri dan dapat diandalkan.
  • Persaingan Harga yang Ketat: Meskipun performanya meningkat, SpaceXAI memilih untuk tidak menaikkan harga. Ini bisa menjadi tekanan bagi kompetitor seperti OpenAI, Google, dan Anthropic.
  • Efisiensi Token Menjadi Isu: Meskipun harga per token sama, penggunaan token yang lebih tinggi menjadi perhatian tersendiri. Pengguna perlu mempertimbangkan biaya operasional secara keseluruhan.


Kesimpulan: Grok 4.7, Mitra Coding Masa Depan?

Dengan kemampuan mengerjakan tugas coding kompleks berjam-jam tanpa henti, memeriksa hasil kerja secara mandiri, dan skor benchmark yang meningkat drastis, Grok 4.7 jelas merupakan salah satu model AI paling canggih saat ini. SpaceXAI berhasil membuktikan bahwa mereka serius bersaing di pasar AI generatif.


Bagi para developer, software engineer, dan perusahaan yang membutuhkan asisten coding yang andal, Grok 4.7 adalah kandidat kuat yang patut dipertimbangkan. Meskipun biaya token bisa lebih tinggi dalam praktik, hasil yang diberikan sebanding dengan investasinya.


Apakah Grok 4.7 akan menjadi standar baru dalam AI coding? Waktu yang akan menjawab. Yang jelas, persaingan di industri AI semakin panas, dan pengguna akan menjadi pihak yang diuntungkan.

Silahkan tinggalkan pesan jika Anda punya saran, kritik, atau pertanyaan seputar topik pembahasan.