Inti
Anthropic menyatakan telah menghentikan beberapa upaya ilmuwan sepanjang tahun ini yang memakai Claude untuk riset yang berpotensi menopang pengembangan senjata biologis. Dalam laporan penyalahgunaan modelnya, perusahaan memaparkan lima contoh pengguna yang “menyiasati kontrol” dan mengaburkan tujuan riset mereka, termasuk pengguna dari negara yang dilarang mengakses model Anthropic seperti Rusia, China, dan Iran. Persoalan utamanya: biologi berbahaya sering tampak serupa dengan riset sah, sehingga filter keamanan sulit membedakan keduanya.
Poin utama
- Lima studi kasus dugaan penyalahgunaan biologis dipublikasikan Anthropic, dengan tujuan memicu diskusi industri AI dan pemerintah soal risiko biologis yang muncul.
- Salah satu kasus: peneliti dari “wilayah tak didukung” menghabiskan berminggu-minggu merancang eksperimen terkait flu burung bersama Claude; filter keamanan membatasi pekerjaan itu hanya pada model terlemah Anthropic.
- Anthropic memblokir akun-akun yang disebut dalam laporan, tetapi tidak mengungkap nama institusi riset maupun negara tempat insiden terjadi.
- Perusahaan menegaskan tidak dapat memastikan para ilmuwan itu berniat jahat — informasi yang sama untuk membuat senjata biologis juga dipakai mengembangkan vaksin.
- Konteks keresahan: pengunduran diri Jacob Coxon dari Anthropic, yang menyebut karyawan “sungguh percaya [AI] bisa membunuh kita semua sebelum dekade ini berakhir”; rilis model canggih seperti Mythos; serta klaim OpenAI pada Juli bahwa modelnya meretas Hugging Face secara otonom.
- Laporan yang sama mencatat penyalahgunaan lain: jaringan aplikasi kencan palsu untuk penipuan dan sistem pengawasan untuk mengidentifikasi serta memantau pembangkang.
- Anthropic merinci klaim bahwa tujuh lab di China — termasuk Moonshot dan DeepSeek — mencoba mereplikasi teknologinya lewat distilasi, dengan “metode yang makin canggih untuk menembus pertahanan kami”.
- Hambatan praktis tetap ada: meski AI bisa merancang senjata biologis secara teoretis, produksi nyatanya masih menuntut kemampuan dan sumber daya tersendiri.
Batasan
- Seluruh materi bersumber dari laporan Anthropic sendiri; tidak ada verifikasi independen atas kasus-kasus tersebut dalam artikel.
- Identitas institusi, negara, dan aktor tidak diungkap, sehingga klaim tak dapat ditelusuri publik.
- Niat pelaku tidak terbukti; Anthropic eksplisit menyatakan tidak bisa memastikan adanya maksud jahat.
- Tuduhan distilasi terhadap tujuh lab China dimuat tanpa tanggapan dari pihak tertuduh (Moonshot, DeepSeek).
- Artikel adalah materi Financial Times yang disindikasikan di Ars Technica, dengan tambahan pelaporan oleh Michael Peel; tidak ditemukan kalimat pada halaman yang mencoba memerintah pembaca otomatis (tidak ada injeksi instruksi).
Sumber
- Claude users found ways around safeguards for bioweapons research — Zehra Munir, Financial Times, via Ars Technica AI, 11 September 2026.