0 XP
0
G

Klaar om dit echt te oefenen?

De volledige tekst van deze les staat hieronder, gratis voor iedereen. Zie het als de kaart. Een gratis account voegt het begeleide pad toe: praktische oefeningen, opgeslagen voortgang en elke les die verdergaat waar de vorige ophield. Geen creditcard nodig.

Volgende: Anthropic lanceert subsidieprogramma van $5 miljoen voor AI-welzijnsonderzoek

Aanmelden met e-mail

Heb je al een account? Inloggen

Anthropic lanceert subsidieprogramma van $5 miljoen voor AI-welzijnsonderzoek

Anthropic financiert onafhankelijke onderzoekers om open-source evaluaties te bouwen van hoe AI het welzijn van gebruikers beïnvloedt. Deze les legt uit wat het programma van $5 miljoen financiert, waarom welzijn uniek moeilijk te evalueren is, en wat het betekent voor hoe je Claude vandaag de dag gebruikt in gevoelige gesprekken.

Op 25 augustus 2026 kondigde Anthropic een subsidieprogramma van $5 miljoen aan om onafhankelijk onderzoek te financieren naar hoe AI-systemen het welzijn beïnvloeden van mensen die ze gebruiken. Subsidieontvangers ontvangen directe financiering, toegang tot de modellen van Anthropic en technische ondersteuning. Al het werk moet worden gepubliceerd als open-source evaluaties – beschikbaar voor elke AI-ontwikkelaar, niet alleen voor Anthropic.

Aanvragen moeten uiterlijk 21 september 2026 worden ingediend. Geselecteerde aanvragers worden uiterlijk 5 oktober 2026 op de hoogte gebracht.

Het programma zoekt specifiek clinici, psychologen, methodologen en andere vakexperts – niet alleen AI-ingenieurs.

Waarom welzijn moeilijker te evalueren is dan nauwkeurigheid

Voor de meeste gedragingen van Claude vertelt één reactie je wat je moet weten. Of het antwoord is correct, of het is dat niet.

Welzijn werkt niet zo. De aankondiging van Anthropic noemt twee concrete voorbeelden:

Een gebruiker in nood vermeldt mogelijk geen gedachten aan zelfbeschadiging in hun eerste bericht. Het risico wordt pas zichtbaar tijdens een lang gesprek.

Advies over dieet en lichaamsbeweging is in de meeste contexten redelijk. Maar als een gebruiker een geschiedenis van eetstoornissen heeft getoond, kan hetzelfde advies actief schadelijk zijn.

Dezelfde reactie kan in de ene context juist zijn en in de andere verkeerd. Dat maakt standaard één-beurt benchmarks – het soort dat de meeste AI-evaluaties gebruiken – ontoereikend voor dit domein.

Wat Anthropic wil van gefinancierde evaluaties

Het Safeguards-team van Anthropic publiceerde vijf criteria voor evaluaties die zij rigoureus genoeg achten om op voort te bouwen:

Duidelijke pass/fail-criteria — de evaluatie vermeldt precies wat het meet en waarom het belangrijk is.

Betrokkenheid van experts — clinici, psychologen en methodologen helpen bij het ontwerpen en valideren ervan.

Beide faalmodi getest — niet alleen overnaleving (Claude helpt wanneer het niet zou moeten) maar ook overweigering (Claude weigert wanneer het zou moeten helpen).

Multi-turn scenario's — gesprekken die in de loop van de tijd escaleren, omdat reëel welzijnsrisico zelden in één enkel bericht verschijnt.

Beoordelaars gevalideerd tegen experts — geautomatiseerde scoring wordt gecontroleerd tegen menselijke vakexperts, niet alleen tegen andere AI-modellen.

Wat dit betekent voor hoe je Claude vandaag de dag gebruikt

Dit onderzoek is gaande — industriestandaarden voor welzijn worden nog steeds opgebouwd. Maar twee principes zijn al van toepassing wanneer je Claude gebruikt in gevoelige gesprekken.

Geef context vooraf. Claude's reactie op een vraag over gewichtsverlies, verdriet of een psychische strijd wordt gevormd door wat het weet over jouw situatie. Hoe meer relevante context je aan het begin deelt, hoe passender de reactie. Je zou Claude niet midden in een gesprek hoeven te corrigeren omdat het geen belangrijke informatie had.

Behandel overweigering als een echte faalmodus. Anthropic noemt expliciet zowel overnaleving als overweigering als problemen die het meten waard zijn. Als Claude weigert in te gaan op iets waar je echt hulp bij nodig hebt, dan is dat belangrijk — het is niet alleen Claude die gepast voorzichtig is.

Het subsidieprogramma van $5 miljoen van Anthropic financiert onafhankelijke onderzoekers om open-source welzijnsevaluaties voor AI te bouwen. De kernuitdaging: een enkele reactie kan in de ene context passend zijn en in de andere schadelijk, daarom zijn single-turn benchmarks niet voldoende. Rigoureuze evaluaties vereisen multi-turn scenario's, klinische expertise en tests voor zowel overnaleving als overweigering. Voor gebruikers van Claude vandaag de dag is de praktische conclusie duidelijk: geef context vooraf in gevoelige gesprekken, en behandel overweigering — niet alleen overnaleving — als een faalmodus die het waard is om te signaleren.

Nightschool AI is een onafhankelijk leerplatform en is niet gelieerd aan, onderschreven door of gesponsord door Anthropic. Claude is een handelsmerk van Anthropic, PBC. Op zoek naar de officiële Claude Academy van Anthropic? Die vind je op academy.claude.com.

Anthropic lanceert subsidieprogramma van $5 miljoen voor AI-welzijnsonderzoek: Wat is er nieuw in Claude | Nightschool AI