Evaluator Independen Kini Bekerja di Dalam Anthropic
Pada 18 September 2026, Anthropic mengumumkan kemitraan dengan unit Faculty AI Accenture untuk menempatkan evaluator independen di dalam perusahaan. Tidak seperti auditor eksternal, evaluator yang tertanam mendapatkan akses setingkat karyawan—mengamati model selama pelatihan, melacak keputusan penerapan, dan memverifikasi komitmen keselamatan dari dalam. Anthropic dan Accenture masing-masing berencana untuk menginvestasikan setidaknya $1 miliar selama lima tahun.
Mulai 18 September 2026, evaluator independen bekerja di dalam Anthropic—bukan di sampingnya. Perbedaan itu penting. Auditor eksternal meninjau sistem AI setelah fakta. Evaluator yang tertanam mengamati model terbentuk selama pelatihan, mengikuti keputusan tentang bagaimana model tersebut dibangun dan diterapkan, dan berbicara langsung dengan karyawan. Dari posisi itu, mereka dapat memverifikasi bahwa komitmen keselamatan dipenuhi dan melaporkan apa yang mereka temukan kepada publik.
Mitra pertama adalah Faculty, unit AI spesialis Accenture. Pekerjaan Faculty akan mencakup evaluasi dan red-teaming model Claude, melakukan penilaian keselarasan, dan menguji perlindungan model. Accenture membantu perusahaan dan pemerintah menerapkan AI di banyak industri—pengalaman penerapan di dunia nyata itu membentuk cara mereka mendekati evaluasi keselamatan. Kedua organisasi berencana untuk menginvestasikan setidaknya $1 miliar masing-masing selama lima tahun ke depan untuk membangun kapasitas di bidang ini.
Evaluasi tertanam adalah hal baru, dan standarnya belum ada. Saat ini tidak ada aturan yang disepakati tentang informasi apa yang harus diakses evaluator tertanam, bagaimana mereka harus melaporkan temuan, atau siapa yang harus mendanai pekerjaan tersebut. Anthropic mendanai pekerjaan Accenture secara langsung untuk saat ini, sementara model pendanaan gabungan atau pemerintah jangka panjang sedang dikembangkan—seperti yang diminta dalam Kerangka AI Canggih Anthropic pada bulan Juni. METR dan evaluator nirlaba lainnya juga sedang diujicobakan secara paralel di bawah pendanaan mereka sendiri. Kemitraan ini tidak eksklusif: Anthropic berencana untuk bekerja dengan evaluator tambahan, dan Accenture dapat bekerja dengan pengembang AI lainnya.
Untuk tim perusahaan yang menggunakan Claude, ini adalah struktur akuntabilitas yang dapat diperiksa. Anthropic dapat menyatakan bahwa Claude aman; sekarang organisasi independen dengan akses setingkat karyawan dapat memverifikasi klaim tersebut. Tujuannya adalah ekosistem evaluator yang bekerja dengan standar bersama—bukan satu audit yang meloloskan atau menggagalkan model, tetapi pengawasan berkelanjutan yang tertanam dalam cara AI perbatasan dibangun.
Poin-poin penting: Evaluator tertanam mendapatkan akses setingkat karyawan—mereka mengamati pelatihan, mengikuti keputusan, dan berbicara dengan staf. Faculty (unit AI Accenture) akan mencakup red-teaming, penilaian keselarasan, dan pengujian perlindungan. Kedua organisasi merencanakan setidaknya $1 miliar masing-masing selama lima tahun. Belum ada standar untuk evaluasi tertanam; Anthropic mendanai Accenture secara langsung sementara model jangka panjang berkembang. Kemitraan ini tidak eksklusif, dan lebih banyak evaluator akan diumumkan.