Baca online, atau dapetin di inbox tiap minggu.
GPT-6 Astra: AGI Beneran, atau Cuma Angka Buat Headline?
OpenAI baru aja rilis GPT-6 Astra (gw udah tulis rilisnya di sini). Dan ada satu angka di pengumumannya yang bikin gw berhenti scroll: 99,9%.
Itu skor Astra di ARC-AGI-3 — tes yang dirancang khusus buat ngukur apakah AI bisa mikir kayak manusia di situasi yang belum pernah dia liat sebelumnya.
Sebagai pembanding: Claude Opus 5 dapet 30,2%. Dan model OpenAI sebelumnya, GPT-5.6 Sol, cuma 7,8%. Dari 7,8 ke 99,9 — dalam satu generasi.
| Model | Skor ARC-AGI-3 |
|---|---|
| GPT-6 Astra | 99,9% |
| Claude Opus 5 | 30,2% |
| GPT-5.6 Sol | 7,8% |
Sumber: halaman rilis resmi OpenAI dan ARC Prize Foundation. Lompatan yang bikin semua orang teriak "AGI udah dateng".
Di artikel ini gw bakal breakdown: apa itu AGI, kenapa Astra bisa dapet skor setinggi itu, dan 3 hal yang bisa kalian lakuin sekarang juga pakai Astra.
Apa Itu AGI?
AGI singkatan dari Artificial General Intelligence.
AI yang kalian pakai sekarang jago di hal-hal yang udah pernah dia pelajarin. Kasih dia soal yang mirip sama data latihannya — dia jago banget. Tapi kasih dia situasi yang benar-benar baru, yang belum pernah dia liat sama sekali — di situ dia mulai keteteran.
AGI artinya AI yang bisa mikir dan beradaptasi di situasi apa pun. Kayak manusia. Nggak perlu dilatih dulu buat tiap kasus baru.
Nah, ARC-AGI-3 itu tes yang dirancang persis buat ngukur kemampuan ini. Mereka kasih AI lingkungan yang belum pernah dia liat, terus liat apakah dia bisa nyari solusinya sendiri — dan seberapa efisien dia belajarnya.
Yang bikin ini kredibel: lembaga penyelenggara tesnya sendiri (ARC Prize Foundation) ngonfirmasi bahwa Astra ngelewatin patokan efisiensi manusia di 96% level — praktis setara manusia.
Tapi baca angkanya dengan konteks
Ada catatan penting di footnote resmi OpenAI: Astra diuji pakai harness khusus milik OpenAI, dengan dua setting yang mereka ubah. Jadi ini bukan perbandingan yang 100% apple-to-apple sama model lain.
Angka pembandingnya juga udah dipublikasiin ARC Prize sendiri: di harness standar yang netral — setup yang sama kayak model lain diuji — Astra dapet 62,7%. Tetap rekor, tetap jauh di atas Opus 5. Tapi 62,7 dan 99,9 itu dua cerita yang beda.
Bukan berarti hasilnya palsu — pihak ketiga udah verifikasi. Tapi kalian perlu tau konteksnya sebelum nelen angka bulat-bulat.
Kenapa Astra Bisa Sedekat Ini ke AGI?
Ada tiga alasan utama.
1. Dia nggak cuma ngomong — dia bisa ngoperasiin komputer
Ini yang paling fundamental. Astra bisa klik, ngetik, buka aplikasi, ngisi form, browsing. Artinya dia belajar dari lingkungan langsung, bukan cuma dari teks. Dan itu jauh lebih dekat ke cara manusia belajar.
Angkanya juga naik drastis. Di benchmark computer use (OSWorld 2.0), Astra dapet 72,6% dibanding 65,7% model sebelumnya — dan waktu ngerjainnya 47% lebih cepet.
2. Memorinya gede banget
Context window-nya lebih dari 1 juta token. Praktisnya: di tugas panjang yang makan berjam-jam, dia nggak lupa sama tujuan awal kalian. Model lama sering "hilang arah" pas sesi kepanjangan — Astra jauh lebih konsisten.
3. Judgment-nya jauh lebih baik
Kalau instruksi kalian ambigu, dia nanya di bagian yang penting, dan ngisi sendiri di bagian yang remeh.
Contoh konkret dari data OpenAI: di tes tugas yang mustahil diselesaikan, model sebelumnya 48% kasusnya nekat keluar dari batas yang diizinkan. Astra? 0%.
Suka artikel ini? Kalian bakal suka newsletter mingguan gw.
3 Hal yang Bisa Kalian Lakuin Sekarang Juga
Ini bagian paling praktis. Gw pilih tiga yang paling gampang dimulai dan paling kerasa dampaknya.
1. Serahin semua kerjaan administratif
Ini kerjaan yang makan waktu tapi nggak butuh mikir keras. Kandidat sempurna buat didelegasiin: ngisi formulir online, update data pelanggan di CRM, ngerapiin kalender, riset online terus dirangkum langsung ke dokumen atau email.
Buka [nama tools/website], terus update data pelanggan berikut:
[tempel data kalian]
Untuk tiap entry, pastiin kolom nama, email, dan status
terisi dengan bener. Kalau ada data yang ambigu atau nggak
lengkap, jangan ditebak — kasih tau gw dulu.
Setelah selesai, kasih gw ringkasan: berapa yang berhasil
diupdate, berapa yang perlu gw cek manual.Tips: bagian "jangan ditebak, kasih tau gw dulu" itu penting. Ini yang bikin output-nya bisa kalian percaya.
2. Bikin website, web app, atau game langsung dari prompt
Lewat fitur Sites di ChatGPT, Astra bisa bikin, hosting, dan share website — langsung dari satu prompt. Nggak perlu setup, nggak perlu ngoding.
Dan yang menarik, dia juga bisa ngetes hasil kerjanya sendiri (frontend QA) — jadi dia cek dulu semua fiturnya jalan atau nggak sebelum nyerahin ke kalian.
Bikinin gw landing page buat [jenis bisnis kalian].
Detail:
- Tujuan utama: [misal: orang daftar waiting list]
- Target audience: [siapa]
- Vibe: [clean / premium / playful]
- Warna: [ISI] · Font: [ISI]
- Section: hero, fitur, testimoni, FAQ, CTA
Bikin mobile-first dan responsive. Setelah jadi, tolong
tes sendiri semua elemen interaktifnya (nav, form, tombol)
di lebar 375px, terus laporin apa yang masih rusak.
Jangan diperbaiki dulu — laporin aja.Kenapa "jangan diperbaiki dulu"? Karena kalian mau liat laporannya dulu sebelum dia ngubah-ngubah. Kalian yang pegang keputusan.
3. Bikin dokumen profesional yang ngikutin template kalian
Ini yang menurut gw paling underrated. Astra dilatih khusus buat ngikutin template dan gaya kalian. Kalian kasih dia template presentasi perusahaan, dia bikin slide baru dengan format, layout, dan tone yang sama persis.
Sama juga buat spreadsheet, dokumen, dan analisa. Hasilnya langsung kepake — nggak perlu dirapiin lagi berjam-jam. Contoh nyatanya ada di review Legora buat dokumen keuangan.
Gw lampirin template presentasi perusahaan gw.
Tolong bikin deck baru tentang [topik], 8-10 slide, pakai
layout dan style yang sama persis kayak template ini.
Struktur yang gw mau:
1. Ringkasan eksekutif
2. [ISI]
3. [ISI]
Tolong ambil cuma poin yang penting — jangan ngulang
informasi yang nggak relevan buat audiens ini
(audiens: [siapa]).Yang Perlu Kalian Tau Sebelum Mulai
Gw mau jujur soal beberapa hal, biar ekspektasi kalian pas.
| Hal | Yang perlu kalian tau |
|---|---|
| Harga | $10 per juta token input, $50 untuk output — sekitar 2,5x model sebelumnya. Pakai buat kerjaan yang beneran butuh. Ukur biaya per tugas selesai, bukan per token. |
| Akses | Rollout bertahap: organisasi terpilih dulu, baru menyebar ke Plus, Pro, Business, Enterprise. Untuk Enterprise, aksesnya mati secara default — admin harus nyalain manual. |
| Safety check | Kemampuan cyber-nya naik drastis (skor 100% di ExploitBench, nemu 2 celah keamanan baru). Jadi monitoring-nya ketat — kadang tugas yang sah ikut ke-pause dan perlu kalian review dulu. Detailnya gw bahas di artikel safety overview Astra. |
| Nggak semua naik | Ada laporan pihak ketiga yang nemu penurunan di beberapa area spesifik. Jangan asal pindah — tes dulu di use case kalian sendiri. |
Penutup
Jadi, GPT-6 Astra ini AGI beneran atau nggak?
Menurut gw, jawaban jujurnya: ini lompatan yang nyata, tapi bukan garis finis.
Angka 99,9% itu impresif dan udah diverifikasi pihak ketiga. Tapi dia dicapai dengan harness khusus, dan "mikir kayak manusia di lingkungan tes" itu masih beda sama "mikir kayak manusia di dunia nyata."
Yang lebih penting buat kalian sebenernya bukan debat AGI-nya. Tapi ini: untuk pertama kalinya, AI bisa beneran ngoperasiin komputer kalian dengan tingkat keandalan yang masuk akal.
Itu yang bakal kerasa di kerjaan kalian sehari-hari. Bukan skor benchmark.
Jadi daripada kalian sibuk debat ini AGI atau bukan — mending kalian coba satu use case kecil dulu. Serahin satu kerjaan administratif yang paling sering kalian ulang. Rasain sendiri bedanya.
Dan kalau kalian mau belajar pakai AI dari nol buat ngebantu kerjaan dan bisnis — bukan teori, tapi langsung praktek — gw ajarin step by step di kelas gw. Makin cepat kalian mulai, makin jauh kalian ninggalin orang-orang yang masih nunggu.
Semua angka di artikel ini diambil dari halaman rilis resmi OpenAI dan ARC Prize Foundation. Kondisi bisa berubah seiring rollout berjalan — cek sumber resminya buat info terbaru.
Sumber primer: halaman rilis GPT-6 Astra (openai.com/index/gpt-6-astra) dan laporan ARC Prize Foundation (arcprize.org/blog/astra).
Build 2ndbrain kalian, tingkatin produktivitas 10x lipat
Mulai BelajarBaca juga
Mistral Raih €3 Miliar — Taruhan buat AI yang Kalian Kontrol Sendiri
Mistral raup €3 miliar dari Samsung dkk untuk membangun AI open-weight yang bikin data, model, dan compute tetap sepenuhnya dalam kontrol pengguna sendiri.
Penulis Protes: Penerbit Rebutan Jatah Settlement Anthropic
Penulis penerima settlement $1,5 miliar dari Anthropic lapor penerbit dan agen mengklaim jatah yang bukan hak mereka — ini cara dispute yang tepat untuk kalian.
Seattle Times dan Newsday Gugat OpenAI Soal Konten Berita
Seattle Times dan Newsday menggugat OpenAI dan Microsoft, menyusul New York Times — menyebut AI generatif sebagai 'konsumen rakus' yang memakan jurnalisme sendiri.