0 XP
0
G

Siap mempraktikkannya sungguhan?

Bacaan lengkap untuk pelajaran ini ada di bawah, gratis untuk siapa saja. Anggap saja sebagai peta. Akun gratis menambahkan jalur terpandu: latihan langsung, progres tersimpan, dan setiap pelajaran melanjutkan dari pelajaran sebelumnya. Tanpa kartu kredit.

Berikutnya: Anthropic Meluncurkan Program Hibah $5 Juta untuk Penelitian Kesejahteraan AI

Daftar dengan email

Sudah punya akun? Masuk

Anthropic Meluncurkan Program Hibah $5 Juta untuk Penelitian Kesejahteraan AI

Anthropic mendanai peneliti independen untuk membangun evaluasi sumber terbuka tentang bagaimana AI memengaruhi kesejahteraan pengguna. Pelajaran ini menjelaskan apa yang didanai oleh program $5 juta, mengapa kesejahteraan sangat sulit dievaluasi, dan apa artinya bagi cara Anda menggunakan Claude dalam percakapan sensitif saat ini.

Pada 25 Agustus 2026, Anthropic mengumumkan program hibah senilai $5 juta untuk mendanai penelitian independen tentang bagaimana sistem AI memengaruhi kesejahteraan orang yang menggunakannya. Penerima hibah menerima dana langsung, akses ke model Anthropic, dan dukungan teknis. Semua pekerjaan harus diterbitkan sebagai evaluasi sumber terbuka — tersedia untuk setiap pengembang AI, bukan hanya Anthropic.

Aplikasi paling lambat 21 September 2026. Pelamar yang terpilih akan diberitahu pada 5 Oktober 2026.

Program ini secara khusus mencari klinisi, psikolog, metodologi, dan pakar materi pelajaran lainnya — bukan hanya insinyur AI.

Mengapa kesejahteraan lebih sulit dievaluasi daripada akurasi

Untuk sebagian besar perilaku Claude, satu respons memberi tahu Anda apa yang perlu Anda ketahui. Entah jawabannya benar atau tidak.

Kesejahteraan tidak berfungsi seperti itu. Pengumuman Anthropic menyebutkan dua contoh konkret:

Pengguna yang sedang dalam kesulitan mungkin tidak menyebutkan pikiran untuk menyakiti diri sendiri dalam pesan pertama mereka. Risiko hanya menjadi terlihat dalam percakapan yang panjang.

Saran tentang diet dan olahraga masuk akal dalam sebagian besar konteks. Tetapi jika pengguna telah menunjukkan riwayat gangguan makan, saran yang sama dapat secara aktif berbahaya.

Respons yang sama bisa benar dalam satu konteks dan salah dalam konteks lain. Itu membuat tolok ukur satu giliran standar — jenis yang digunakan sebagian besar evaluasi AI — tidak memadai untuk domain ini.

Apa yang diinginkan Anthropic dari evaluasi yang didanai

Tim Safeguards Anthropic menerbitkan lima kriteria untuk evaluasi yang mereka anggap cukup ketat untuk dibangun:

Kriteria lulus/gagal yang jelas — evaluasi menyatakan dengan tepat apa yang diukurnya dan mengapa itu penting.

Keterlibatan ahli — klinisi, psikolog, dan metodologi membantu merancang dan memvalidasinya.

Kedua mode kegagalan diuji — tidak hanya kepatuhan berlebihan (Claude membantu ketika seharusnya tidak) tetapi juga penolakan berlebihan (Claude menolak ketika seharusnya membantu).

Skenario multi-giliran — percakapan yang meningkat seiring waktu, karena risiko kesejahteraan nyata jarang muncul dalam satu pesan.

Penilai divalidasi terhadap ahli — penilaian otomatis diperiksa terhadap ahli materi pelajaran manusia, bukan hanya model AI lainnya.

Apa artinya ini untuk cara Anda menggunakan Claude hari ini

Penelitian ini sedang berlangsung — standar industri untuk kesejahteraan masih dibangun. Tetapi dua prinsip sudah berlaku ketika Anda menggunakan Claude dalam percakapan sensitif.

Berikan konteks di awal. Respons Claude terhadap pertanyaan tentang penurunan berat badan, kesedihan, atau perjuangan kesehatan mental dibentuk oleh apa yang diketahuinya tentang situasi Anda. Semakin banyak konteks relevan yang Anda bagikan di awal, semakin sesuai responsnya. Anda seharusnya tidak perlu mengoreksi Claude di tengah percakapan karena tidak memiliki informasi kunci.

Perlakukan penolakan berlebihan sebagai mode kegagalan nyata. Anthropic secara eksplisit menyebutkan kepatuhan berlebihan dan penolakan berlebihan sebagai masalah yang layak diukur. Jika Claude menolak untuk terlibat dengan sesuatu yang benar-benar Anda butuhkan bantuannya, itu penting — itu bukan hanya Claude yang berhati-hati.

Program hibah $5 juta Anthropic mendanai peneliti independen untuk membangun evaluasi kesejahteraan sumber terbuka untuk AI. Tantangan intinya: satu respons dapat sesuai dalam satu konteks dan berbahaya dalam konteks lain, itulah sebabnya tolok ukur satu giliran tidak cukup. Evaluasi yang ketat membutuhkan skenario multi-giliran, keahlian klinis, dan pengujian untuk kepatuhan berlebihan dan penolakan berlebihan. Bagi pengguna Claude hari ini, kesimpulan praktisnya jelas: berikan konteks di awal dalam percakapan sensitif, dan perlakukan penolakan berlebihan — bukan hanya kepatuhan berlebihan — sebagai mode kegagalan yang layak ditandai.

Nightschool AI adalah platform pembelajaran independen dan tidak berafiliasi dengan, didukung oleh, atau disponsori oleh Anthropic. Claude adalah merek dagang dari Anthropic, PBC. Mencari Claude Academy resmi dari Anthropic? Kunjungi academy.claude.com.

Anthropic Meluncurkan Program Hibah $5 Juta untuk Penelitian Kesejahteraan AI: Apa yang Baru di Claude | Nightschool AI