Unabhängige Evaluatoren arbeiten jetzt bei Anthropic
Am 18. September 2026 gab Anthropic eine Partnerschaft mit der Faculty AI-Einheit von Accenture bekannt, um unabhängige Evaluatoren in das Unternehmen zu integrieren. Im Gegensatz zu externen Auditoren erhalten eingebettete Evaluatoren Mitarbeiterzugang – sie beobachten Modelle während des Trainings, verfolgen Bereitstellungsentscheidungen und überprüfen Sicherheitszusagen von innen heraus. Anthropic und Accenture planen jeweils, über fünf Jahre mindestens 1 Milliarde US-Dollar zu investieren.
Ab dem 18. September 2026 arbeiten unabhängige Evaluatoren bei Anthropic – nicht nur daneben. Dieser Unterschied ist wichtig. Externe Auditoren überprüfen KI-Systeme nachträglich. Eingebettete Evaluatoren beobachten Modelle während des Trainings, verfolgen die Entscheidungen darüber, wie diese Modelle gebaut und eingesetzt werden, und sprechen direkt mit den Mitarbeitern. Von dieser Position aus können sie überprüfen, ob Sicherheitszusagen eingehalten werden, und ihre Erkenntnisse der Öffentlichkeit mitteilen.
Der erste Partner ist Faculty, die spezialisierte KI-Einheit von Accenture. Die Arbeit von Faculty umfasst die Evaluierung und das Red-Teaming von Claude-Modellen, die Durchführung von Ausrichtungsbewertungen und das Testen von Modellsicherheitsvorkehrungen. Accenture hilft Unternehmen und Regierungen, KI in vielen Branchen einzusetzen – diese reale Bereitstellungserfahrung prägt ihren Ansatz zur Sicherheitsbewertung. Beide Organisationen planen, in den nächsten fünf Jahren jeweils mindestens 1 Milliarde US-Dollar in den Aufbau von Kapazitäten in diesem Bereich zu investieren.
Die eingebettete Evaluierung ist neu, und die Standards existieren noch nicht. Es gibt derzeit keine vereinbarten Regeln dafür, auf welche Informationen eingebettete Evaluatoren zugreifen sollten, wie sie Ergebnisse melden sollten oder wer die Arbeit finanzieren sollte. Anthropic finanziert die Arbeit von Accenture vorerst direkt, während längerfristige gebündelte oder staatliche Finanzierungsmodelle entwickelt werden – wie im Advanced AI Framework von Anthropic im Juni gefordert. METR und andere gemeinnützige Evaluatoren werden ebenfalls parallel unter eigener Finanzierung pilotiert. Die Partnerschaft ist nicht exklusiv: Anthropic plant, mit weiteren Evaluatoren zusammenzuarbeiten, und Accenture kann mit anderen KI-Entwicklern zusammenarbeiten.
Für Unternehmensteams, die Claude verwenden, ist dies die überprüfbare Rechenschaftsstruktur. Anthropic kann erklären, dass Claude sicher ist; jetzt kann eine unabhängige Organisation mit Mitarbeiterzugang diese Behauptung überprüfen. Ziel ist ein Ökosystem von Evaluatoren, die mit gemeinsamen Standards arbeiten – keine einzelne Prüfung, die ein Modell besteht oder nicht besteht, sondern eine kontinuierliche Überwachung, die in den Aufbau von Frontier AI eingebettet ist.
Wichtige Erkenntnisse: Eingebettete Evaluatoren erhalten Mitarbeiterzugang – sie beobachten das Training, verfolgen Entscheidungen und sprechen mit Mitarbeitern. Faculty (Accenture's KI-Einheit) wird Red-Teaming, Ausrichtungsbewertungen und Sicherheitstests abdecken. Beide Organisationen planen jeweils mindestens 1 Milliarde US-Dollar über fünf Jahre. Es gibt noch keine Standards für die eingebettete Evaluierung; Anthropic finanziert Accenture direkt, während längerfristige Modelle entwickelt werden. Die Partnerschaft ist nicht exklusiv, und weitere Evaluatoren werden bekannt gegeben.