AI Update

Anthropic Bongkar Kampanye Distilasi 200 Juta Chat dari China

Anthropic laporkan hampir 200 juta percakapan Claude dieksploitasi lewat kampanye distilasi dari Alibaba, Moonshot AI, dan DeepSeek buat latih model saingan.

Diterbitkan oleh 2ndBrAIn14 September 20263 min read
Share:XFacebookWhatsApp
Anthropic Bongkar Distilasi 200 Juta Chat

Kalau kalian ngerasa nyaman curhat panjang ke Claude soal logika bisnis atau debug kode rumit, ada kabar yang bikin gw mikir dua kali: proses mikir di baliknya ternyata jadi rebutan diam-diam antar lab AI raksasa.

Apa yang baru

  • Hampir 200 juta pertukaran tercatat terkait lima kampanye distilasi berbeda ke Claude, menurut laporan terbaru Anthropic.
  • Kampanye Alibaba jadi yang terbesar yang pernah dicatat Anthropic — 151 juta pertukaran dari Mei sampai Juli 2026, tersebar di 3.500 akun, sempat menyentuh hampir tiga juta pertukaran per hari.
  • Moonshot AI (pembuat Kimi) merutekan sekitar 300.000 permintaan lewat 5.000 akun cuma dalam 10 hari, termasuk permintaan menganalisis rekaman CCTV yang diduga berasal dari militer China.
  • Triknya pakai prompt injection — satu contoh menyamar sebagai permintaan terjemahan, minta Claude "menerjemahkan working memory-nya" ke bahasa Jepang biar proses mikir mentahnya keluar.
  • Bukan kejadian baru — Anthropic sudah menyinggung serangan serupa sejak Februari, dan OpenAI pernah melaporkan pola yang mereka atribusikan ke DeepSeek.

Kenapa ini penting

Claude biasanya cuma nunjukin "ringkasan mikir" ke kalian, bukan proses berpikirnya yang mentah — mirip draf coretan seorang editor sebelum naskah itu dirapikan jadi artikel final. Yang serangan distilasi lakuin adalah mancing Claude buat bocorin coretan mentah itu, bukan cuma hasil rapinya, terus dipakai buat melatih model lain biar nalarnya mirip.

Buat kalian yang bangun produk pakai Claude API atau ngandelin web interface-nya buat kerjaan sehari-hari, ini bukan cuma drama antar-perusahaan. Teknik yang kepakai — nyamar jadi permintaan terjemahan, atau format aneh yang mancing model "jujur" soal proses internalnya — bisa jadi cetak biru buat siapa pun yang mau ngutak-atik agent kalian sendiri lewat prompt injection, termasuk buat nyolong data sensitif yang kalian taruh di prompt.

Yang bikin ini makin relevan: salah satu pelaku, Moonshot AI, adalah tim di balik Kimi K3 yang belum lama ini dirilis sebagai model open-weight terbesar sejarah — dan sekarang jelas kelihatan salah satu cara mereka ngejar performa frontier.

Bacaan berguna, sekali seminggu.

Kabar AI penting, konteksnya, dan satu hal yang bisa langsung kalian praktikkan.

Buat kalian

  • Yang harus peduli: kalian yang bangun agent atau produk di atas Claude API, apalagi yang nge-handle data klien atau bisnis sensitif — pola prompt injection yang kepakai di laporan ini bisa dicontek buat serang sistem kalian sendiri.
  • Yang boleh santai: kalau kalian cuma pakai Claude buat chat harian atau nulis draf, kalian bukan target — serangan ini butuh skala ribuan akun dan infrastruktur khusus buat nge-harvest chain-of-thought.
  • Langkah kecil pertama: cek lagi system prompt kalian — jangan taruh instruksi rahasia atau data sensitif di sana yang bisa "dipancing keluar" lewat permintaan aneh semacam permintaan terjemahan atau reformat.

Yang lebih besar dari drama Alibaba-vs-Anthropic ini adalah prinsip pertahanan berlapis — jangan pernah anggap satu model atau satu vendor bakal ngejamin keamanan penuh, karena serangan hari ini nyari celah di prompt, bukan cuma di server. Itu salah satu hal yang gw bahas detail bareng murid-murid di kelas gw.

Sumber primer: laporan Anthropic seperti dilaporkan TechCrunch (techcrunch.com, "Anthropic details distillation campaigns from Alibaba, Moonshot AI, and DeepSeek", 10 September 2026).

Lebih paham AI. Lebih siap menggunakannya.

Newsletter mingguan berisi kabar penting, konteks yang jernih, dan praktik yang bisa dicoba.

Belajar build sistem AI yang bekerja buat kalian

Lihat akademi