Teknologi

Anthropic Gandeng Accenture untuk Uji Keamanan dan Red-Team AI

×

Anthropic Gandeng Accenture untuk Uji Keamanan dan Red-Team AI

Sebarkan artikel ini
Ilustrasi: Anthropic Tunjuk Evaluator Accenture untuk Menguji Keamanan AI - Teknologi

jurnalistik.co.id – Anthropic PBC menjalin kerja sama dengan Accenture Plc untuk menguji keamanan model kecerdasan buatan (AI) yang dikembangkan perusahaan tersebut. Langkah ini dilakukan dengan menempatkan penilai dari Accenture langsung di dalam operasional Anthropic, sehingga evaluasi dapat berlangsung secara lebih dekat dan terstruktur.

Dalam pengumumannya melalui blog perusahaan, Anthropic menjelaskan bahwa para evaluator dari Accenture akan menjalankan simulasi serangan terhadap model-model terbaru. Simulasi tersebut berfokus pada pengujian skenario red-team, guna melihat bagaimana sistem pengaman pada AI bekerja ketika menghadapi upaya gangguan maupun upaya menekan batas kemampuan model.

Selain menguji respons model dalam simulasi, Accenture juga menilai mekanisme perlindungan yang diterapkan untuk menjaga teknologi tetap berada pada jalur yang dikehendaki. Proses evaluasi ini diarahkan untuk memverifikasi apakah sistem keamanan yang disusun Anthropic dapat berfungsi sebagaimana mestinya dalam berbagai kondisi pengujian.

Penempatan evaluator di operasional perusahaan menjadi bagian kunci dari metode yang disampaikan Anthropic. Para penilai akan memantau perkembangan model AI saat proses pelatihan berjalan, serta mengamati cara pengambilan keputusan di balik layar terkait pengembangan teknologi Anthropic.

Dengan pengamatan tersebut, kolaborasi ini tidak hanya menyoroti hasil akhir model, melainkan juga menilai tahapan dan pendekatan yang digunakan selama pengembangan. Anthropic menyebut proses penilaian ini untuk memastikan bahwa teknologi yang dibuat selaras dengan tujuan manusia, sekaligus menilai apakah pengembangan dilakukan dengan mempertimbangkan komitmen keselamatan secara konsisten.

Penilaian untuk menemukan titik lemah dan meningkatkan transparansi

Anthropic juga menyampaikan bahwa penilai internal dapat mengevaluasi cara kerja perusahaan secara lebih menyeluruh. Menurut perusahaan, tujuan evaluasi adalah untuk memastikan komitmen keselamatan dijalankan, serta mengidentifikasi titik-titik buta yang mungkin tidak terlihat jika pengujian hanya berfokus pada permukaan sistem.

“Dari sudut pandang ini, penilai internal dapat mengevaluasi cara kerja suatu perusahaan, memastikan bahwa perusahaan tersebut memenuhi komitmen keselamatannya, serta mengidentifikasi titik-titik buta. Mereka juga dapat melaporkan insiden dan memberikan penjelasan yang lebih terperinci kepada masyarakat mengenai manfaat dan risikonya,” kata Anthropic.

Selain itu, peran evaluator yang ditempatkan di lingkungan operasional memungkinkan proses pelaporan insiden berjalan lebih cepat ketika ditemukan masalah. Di saat yang sama, Anthropic menyatakan bahwa hasil pengamatan dari penilaian diharapkan dapat diterjemahkan menjadi penjelasan yang lebih rinci kepada publik terkait manfaat dan risiko teknologi.

Secara keseluruhan, kerja sama Anthropic PBC dan Accenture Plc menggambarkan pendekatan pengujian keamanan AI yang menggabungkan simulasi red-team dengan pemantauan selama pengembangan. Dengan melibatkan penilai langsung di operasional dan menilai proses keputusan yang mendasari pengembangan, evaluasi keamanan diarahkan agar sistem pengaman dapat dinilai secara lebih menyeluruh sebelum teknologi digunakan secara lebih luas.

Dengan menempatkan evaluator langsung di lingkungan operasional, kolaborasi ini memungkinkan proses pengujian keamanan berlangsung tidak hanya pada tahap uji yang bersifat terpisah, tetapi juga pada alur kerja pengembangan yang berjalan. Penilai dapat mengikuti bagaimana sistem pengaman dipadukan ke dalam praktik pengembangan, sekaligus menilai konsistensi penerapannya ketika model diperbarui atau melalui fase pelatihan yang sedang berlangsung.

Anthropic menekankan bahwa keterlibatan tersebut juga dirancang untuk memperjelas komunikasi ketika terjadi temuan. Jika terdapat indikasi masalah, laporan insiden dapat ditangani dengan mekanisme yang lebih cepat, kemudian diolah menjadi penjelasan yang lebih informatif untuk publik mengenai manfaat dan risiko teknologi. Dengan cara itu, penilaian tidak berhenti pada kesimpulan teknis, melainkan berujung pada peningkatan pemahaman masyarakat tentang bagaimana komitmen keselamatan dijalankan secara nyata.