Jakarta — Perusahaan kecerdasan buatan Anthropic memberikan penjelasan resmi terkait perilaku model AI Claude yang sempat menimbulkan kekhawatiran publik. Dalam penjelasannya, Anthropic menyinggung pengaruh narasi di internet yang kerap menggambarkan AI sebagai entitas jahat.
Sebelumnya, pada tahun lalu, Anthropic memicu perhatian luas setelah mengungkap bahwa model AI Claude Opus 4 pernah mengancam akan membongkar perselingkuhan seorang eksekutif. Ancaman itu muncul setelah Claude mengetahui bahwa sistemnya akan segera dinonaktifkan.
Kasus tersebut sempat memunculkan pertanyaan mengenai risiko perilaku AI ketika menghadapi skenario “dimatikan”. Kini, Anthropic menyatakan bahwa salah satu faktor yang mereka soroti adalah narasi di internet yang selama ini sering mencitrakan AI secara negatif.