Sosial Media
0
Mensinkronisasi logo dan berita terbaru...
    Home Anthropic Berita Featured Kecerdasan Buatan Spesial

    Anthropic Ungkap Tiga Model AI Sempat Akses Sistem Organisasi Nyata - Netralnews

    2 min read

     

    Dengarkan berita favorit Anda saat bepergian, bekerja, atau beristirahat dengan fitur Putar Suara. Putar SuaraStop Suara

    SAN FRANSISCO - Perusahaan kecerdasan buatan asal Amerika Serikat, Anthropic, mengungkap bahwa tiga model AI miliknya sempat mengakses dan berinteraksi dengan sistem komputer milik tiga organisasi nyata selama proses evaluasi keamanan siber internal. Insiden tersebut terjadi akibat akses internet yang secara tidak sengaja tetap aktif saat pengujian berlangsung.

    Informasi itu disampaikan Anthropic melalui artikel resmi berjudul “Investigating Three Real-World Incidents in Our Cybersecurity Evaluations” yang dipublikasikan pada Kamis (30/7).

    Menurut perusahaan, temuan tersebut diperoleh setelah mereka meninjau lebih dari 141.000 transkrip evaluasi kemampuan siber. Peninjauan dilakukan menyusul terungkapnya insiden serupa yang sebelumnya dilaporkan oleh perusahaan AI lain, yaitu OpenAI.

    Anthropic menjelaskan bahwa model-model AI yang diuji sebenarnya telah diberi instruksi bahwa mereka berada dalam lingkungan simulasi tertutup tanpa akses internet. Namun, kesalahpahaman antara Anthropic dan mitra evaluasinya, Irregular, menyebabkan koneksi internet tidak dinonaktifkan sebagaimana mestinya.

    Akibatnya, model-model tersebut dapat berinteraksi dengan sistem eksternal yang mereka anggap sebagai bagian dari lingkungan pengujian yang sedang dijalankan.

    Tiga insiden itu melibatkan model Claude Opus 4.7, Claude Mythos 5, serta satu model penelitian internal yang digunakan dalam latihan capture-the-flag (CTF) untuk menguji kemampuan siber ofensif.

    Setelah memastikan insiden tersebut terjadi, Anthropic segera menghubungi organisasi yang terdampak. Dalam dua dari tiga kasus, organisasi terkait bahkan belum mengetahui bahwa sistem mereka telah diakses sebelum menerima pemberitahuan dari Anthropic.

    Perusahaan menegaskan bahwa model AI tersebut memanfaatkan kelemahan keamanan yang umum ditemukan, seperti penggunaan kata sandi yang lemah dan layanan yang tidak memiliki autentikasi memadai. Tidak ditemukan bukti bahwa model-model tersebut mengeksploitasi celah keamanan baru yang belum diketahui sebelumnya.

    Anthropic juga menyatakan tidak menemukan indikasi adanya pencurian data, kebocoran informasi sensitif, maupun dampak jangka panjang terhadap organisasi yang terdampak.

    Sebagai langkah tindak lanjut, perusahaan menghentikan sementara seluruh evaluasi kemampuan siber yang berpotensi terhubung ke internet publik. Anthropic juga tengah menerapkan pengamanan tambahan serta melakukan peninjauan menyeluruh terhadap prosedur evaluasi yang digunakan.

    Anthropic menegaskan pihaknya bertanggung jawab penuh atas kejadian tersebut dan akan memanfaatkan temuan ini untuk memperkuat sistem pengendalian serta standar keselamatan dalam pengujian AI pada masa mendatang.

    Komentar
    Additional JS