Onafhankelijke Evaluatoren Werken Nu Binnen Anthropic
Op 18 september 2026 kondigde Anthropic een partnerschap aan met Accenture's Faculty AI-eenheid om onafhankelijke evaluatoren binnen het bedrijf in te bedden. In tegenstelling tot externe auditors krijgen ingebedde evaluatoren toegang op medewerkersniveau – ze observeren modellen tijdens training, volgen implementatiebeslissingen en verifiëren veiligheidsverbintenissen van binnenuit. Anthropic en Accenture zijn elk van plan om de komende vijf jaar minstens $1 miljard te investeren.
Vanaf 18 september 2026 werken onafhankelijke evaluatoren binnen Anthropic – niet ernaast. Dat onderscheid is belangrijk. Externe auditors beoordelen AI-systemen achteraf. Ingebouwde evaluatoren zien modellen vorm krijgen tijdens de training, volgen de beslissingen over hoe die modellen worden gebouwd en geïmplementeerd, en spreken rechtstreeks met medewerkers. Vanuit die positie kunnen ze verifiëren dat veiligheidsverbintenissen worden nagekomen en hun bevindingen aan het publiek rapporteren.
De eerste partner is Faculty, de gespecialiseerde AI-eenheid van Accenture. Het werk van Faculty omvat het evalueren en red-teaming van Claude-modellen, het uitvoeren van afstemmingsbeoordelingen en het testen van modelbeveiligingen. Accenture helpt bedrijven en overheden AI te implementeren in vele sectoren – die praktijkervaring met implementatie vormt hun benadering van veiligheidsevaluatie. Beide organisaties zijn van plan om de komende vijf jaar elk minstens $1 miljard te investeren in het opbouwen van capaciteit op dit gebied.
Ingebouwde evaluatie is nieuw, en de standaarden bestaan nog niet. Er zijn momenteel geen overeengekomen regels voor welke informatie ingebouwde evaluatoren moeten raadplegen, hoe ze bevindingen moeten rapporteren, of wie het werk moet financieren. Anthropic financiert het werk van Accenture voorlopig rechtstreeks, terwijl langetermijnmodellen voor gebundelde of overheidsfinanciering worden ontwikkeld – zoals gevraagd in Anthropic's Advanced AI Framework in juni. METR en andere non-profit evaluatoren worden ook parallel getest onder hun eigen financiering. Het partnerschap is niet-exclusief: Anthropic is van plan samen te werken met aanvullende evaluatoren, en Accenture kan samenwerken met andere AI-ontwikkelaars.
Voor bedrijfsteams die Claude gebruiken, is dit de verantwoordelijkheidsstructuur die controleerbaar is gemaakt. Anthropic kan stellen dat Claude veilig is; nu kan een onafhankelijke organisatie met toegang op medewerkersniveau die claim verifiëren. Het doel is een ecosysteem van evaluatoren die werken met gedeelde standaarden – geen enkele audit die een model goed- of afkeurt, maar voortdurend toezicht ingebed in de manier waarop frontier AI wordt gebouwd.
Belangrijkste punten: Ingebouwde evaluatoren krijgen toegang op medewerkersniveau – ze observeren training, volgen beslissingen en spreken met personeel. Faculty (Accenture's AI-eenheid) zal red-teaming, afstemmingsbeoordelingen en beveiligingstests uitvoeren. Beide organisaties zijn van plan om elk minstens $1 miljard te investeren over vijf jaar. Er bestaan nog geen standaarden voor ingebouwde evaluatie; Anthropic financiert Accenture rechtstreeks terwijl langetermijnmodellen worden ontwikkeld. Het partnerschap is niet-exclusief, en er zullen meer evaluatoren worden aangekondigd.