Valutatori Indipendenti Ora Lavorano All'Interno di Anthropic
Il 18 settembre 2026, Anthropic ha annunciato una partnership con l'unità Faculty AI di Accenture per integrare valutatori indipendenti all'interno dell'azienda. A differenza degli auditor esterni, i valutatori integrati ottengono un accesso a livello di dipendente, osservando i modelli durante l'addestramento, monitorando le decisioni di implementazione e verificando gli impegni di sicurezza dall'interno. Anthropic e Accenture prevedono di investire almeno 1 miliardo di dollari ciascuno in cinque anni.
A partire dal 18 settembre 2026, i valutatori indipendenti lavorano all'interno di Anthropic, non al suo fianco. Questa distinzione è importante. Gli auditor esterni esaminano i sistemi di intelligenza artificiale a posteriori. I valutatori integrati osservano i modelli prendere forma durante l'addestramento, seguono le decisioni su come tali modelli vengono costruiti e implementati e parlano direttamente con i dipendenti. Da questa posizione, possono verificare che gli impegni di sicurezza vengano mantenuti e riferire al pubblico ciò che trovano.
Il primo partner è Faculty, l'unità AI specialistica di Accenture. Il lavoro di Faculty coprirà la valutazione e il red-teaming dei modelli Claude, la conduzione di valutazioni di allineamento e il test delle salvaguardie del modello. Accenture aiuta le imprese e i governi a implementare l'IA in molti settori: questa esperienza di implementazione nel mondo reale modella il loro approccio alla valutazione della sicurezza. Entrambe le organizzazioni prevedono di investire almeno 1 miliardo di dollari ciascuna nei prossimi cinque anni per costruire capacità in quest'area.
La valutazione integrata è nuova e gli standard non esistono ancora. Attualmente non ci sono regole concordate su quali informazioni i valutatori integrati dovrebbero accedere, come dovrebbero riportare i risultati o chi dovrebbe finanziare il lavoro. Anthropic sta finanziando direttamente il lavoro di Accenture per ora, mentre vengono sviluppati modelli di finanziamento a lungo termine, congiunti o governativi, come richiesto nel Framework AI Avanzato di Anthropic a giugno. METR e altri valutatori senza scopo di lucro vengono anche pilotati in parallelo con i propri finanziamenti. La partnership non è esclusiva: Anthropic prevede di lavorare con ulteriori valutatori e Accenture potrebbe lavorare con altri sviluppatori di IA.
Per i team aziendali che utilizzano Claude, questa è la struttura di responsabilità resa verificabile. Anthropic può affermare che Claude è sicuro; ora un'organizzazione indipendente con accesso a livello di dipendente può verificare tale affermazione. L'obiettivo è un ecosistema di valutatori che lavorano con standard condivisi, non un singolo audit che promuove o boccia un modello, ma una supervisione continua integrata nel modo in cui viene costruita l'IA di frontiera.
Punti chiave: I valutatori integrati ottengono accesso a livello di dipendente: osservano l'addestramento, seguono le decisioni e parlano con il personale. Faculty (l'unità AI di Accenture) si occuperà di red-teaming, valutazioni di allineamento e test delle salvaguardie. Entrambe le organizzazioni prevedono almeno 1 miliardo di dollari ciascuna in cinque anni. Non esistono ancora standard per la valutazione integrata; Anthropic sta finanziando direttamente Accenture mentre si sviluppano modelli a lungo termine. La partnership non è esclusiva e verranno annunciati altri valutatori.