Sistem AI Anthropic Ungguli Metode Peneliti Manusia dalam Enam Jam
Rangkuman otomatis · disusun dengan AI

Anthropic mengembangkan sistem AI bernama Automated Alignment Researcher (AAR) yang mampu menjalankan sebagian proses penelitian untuk memperbaiki model AI lain. Dalam pengujian pada 10 tolok ukur alignment, sistem ini berhasil meningkatkan kinerja pada seluruh pengujian tanpa menurunkan kemampuan model secara keseluruhan. Metode terbaik AAR bahkan mengungguli metode yang diusulkan oleh peneliti manusia berpengalaman, dengan rata-rata waktu enam jam untuk menemukan solusi optimal.
AAR bekerja dengan mencari literatur yang tersedia, mengusulkan metode, melatih model selama 30 menit, lalu mengulang proses ini dalam beberapa tahap. Metode yang efektif dipertahankan, sementara yang tidak efektif dibuang. Dari sisi biaya, inferensi API untuk AAR hanya membutuhkan sekitar 4 dolar AS per jam, jauh lebih murah dibandingkan biaya sekitar 150 dolar AS per jam yang dibayarkan Anthropic untuk peneliti manusia.
Riset ini dianggap sebagai langkah menuju recursive self-improvement, di mana AI dapat membantu meningkatkan sistem AI berikutnya secara berulang. Namun, kemampuan sistem otomatis ini masih bergantung pada kualitas tolok ukur yang digunakan. Jika tolok ukur tidak mencerminkan tujuan alignment dengan benar, hasil yang dicapai bisa meleset. Oleh karena itu, masih diperlukan pekerjaan untuk membangun dan mempertahankan tolok ukur serta literatur yang menjadi sumber rujukan bagi sistem peneliti otomatis.
Bagikan
Berita terkait
Investor Perkirakan Valuasi Anthropic Tembus 2 Triliun Dolar AS jika IPO Oktober
VOI · 14 Agustus 2026 pukul 11.45
Megawati Ingatkan Etika AI: Jangan Sampai Kalahkan Akal Manusia
VOI · 29 Agustus 2026 pukul 11.28
Claudeforce Resmi Meluncur, Salesforce dan Anthropic Perluas Kolaborasi AI
JPNN.com · 28 Agustus 2026 pukul 19.24
Ratusan Raksasa Teknologi Peringatkan Ancaman AI: Serangan Siber Akan Meluas
kumparan · 28 Agustus 2026 pukul 19.00