独立評価者がAnthropic社内で業務を開始
2026年9月18日、AnthropicはアクセンチュアのFaculty AI部門との提携を発表し、独立評価者を社内に組み込むことになりました。外部監査人とは異なり、組み込み型評価者は従業員レベルのアクセス権を持ち、トレーニング中のモデルを監視し、展開決定を追跡し、内部から安全コミットメントを検証します。Anthropicとアクセンチュアはそれぞれ、今後5年間で少なくとも10億ドルを投資する計画です。
2026年9月18日以降、独立評価者はAnthropicの社内で業務を行います。この区別は重要です。外部監査人はAIシステムを事後にレビューします。組み込み型評価者は、トレーニング中にモデルが形成されるのを監視し、それらのモデルがどのように構築され展開されるかに関する決定を追跡し、従業員と直接話します。その立場から、安全コミットメントが守られていることを検証し、その結果を一般に報告することができます。
最初のパートナーは、アクセンチュアの専門AI部門であるFacultyです。Facultyの業務には、Claudeモデルの評価とレッドチーム化、アライメント評価の実施、モデルの安全対策のテストが含まれます。アクセンチュアは、多くの業界で企業や政府がAIを展開するのを支援しており、その実世界での展開経験が、安全評価へのアプローチを形作っています。両組織は、今後5年間でこの分野の能力構築にそれぞれ少なくとも10億ドルを投資する計画です。
組み込み型評価は新しく、まだ標準が存在しません。組み込み型評価者がどのような情報にアクセスすべきか、どのように調査結果を報告すべきか、誰がその作業に資金を提供すべきかについて、現在合意されたルールはありません。Anthropicは、長期的なプール型または政府資金調達モデルが開発されるまで、当面の間、アクセンチュアの作業に直接資金を提供しています。これは、6月のAnthropicのAdvanced AI Frameworkで求められていたものです。METRやその他の非営利評価者も、独自の資金で並行して試験運用されています。このパートナーシップは非独占的であり、Anthropicは追加の評価者と協力する予定であり、アクセンチュアは他のAI開発者と協力する可能性があります。
Claudeを使用する企業チームにとって、これは検証可能な説明責任構造です。AnthropicはClaudeが安全であると述べることができます。そして今、従業員レベルのアクセス権を持つ独立した組織がその主張を検証できます。目標は、共有された標準で機能する評価者のエコシステムです。モデルを合格または不合格にする単一の監査ではなく、フロンティアAIの構築方法に組み込まれた継続的な監視です。
主なポイント:組み込み型評価者は従業員レベルのアクセス権を持ち、トレーニングを監視し、決定を追跡し、スタッフと話します。Faculty(アクセンチュアのAI部門)は、レッドチーム化、アライメント評価、安全対策テストを担当します。両組織は、今後5年間でそれぞれ少なくとも10億ドルを計画しています。組み込み型評価の標準はまだ存在せず、Anthropicは長期的なモデルが開発されるまでアクセンチュアに直接資金を提供しています。このパートナーシップは非独占的であり、さらに多くの評価者が発表される予定です。