ผู้ประเมินอิสระทำงานภายใน Anthropic แล้ว
เมื่อวันที่ 18 กันยายน 2026 Anthropic ได้ประกาศความร่วมมือกับหน่วย Faculty AI ของ Accenture เพื่อฝังผู้ประเมินอิสระไว้ภายในบริษัท ซึ่งแตกต่างจากผู้ตรวจสอบภายนอก ผู้ประเมินที่ฝังตัวจะได้รับสิทธิ์การเข้าถึงในระดับพนักงาน โดยจะเฝ้าดูโมเดลในระหว่างการฝึกอบรม ติดตามการตัดสินใจในการปรับใช้ และตรวจสอบความมุ่งมั่นด้านความปลอดภัยจากภายใน Anthropic และ Accenture แต่ละฝ่ายวางแผนที่จะลงทุนอย่างน้อย 1 พันล้านดอลลาร์ในระยะเวลาห้าปี
ตั้งแต่วันที่ 18 กันยายน 2026 เป็นต้นไป ผู้ประเมินอิสระจะทำงานภายใน Anthropic ไม่ใช่แค่ทำงานร่วมกัน ความแตกต่างนี้สำคัญ ผู้ตรวจสอบภายนอกจะตรวจสอบระบบ AI หลังจากเกิดเหตุการณ์ขึ้นแล้ว ผู้ประเมินที่ฝังตัวจะเฝ้าดูโมเดลที่กำลังก่อร่างสร้างตัวในระหว่างการฝึกอบรม ติดตามการตัดสินใจเกี่ยวกับวิธีการสร้างและปรับใช้โมเดลเหล่านั้น และพูดคุยโดยตรงกับพนักงาน จากตำแหน่งนั้น พวกเขาสามารถตรวจสอบได้ว่ามีการปฏิบัติตามข้อผูกพันด้านความปลอดภัยหรือไม่ และรายงานสิ่งที่พบต่อสาธารณะ
พันธมิตรรายแรกคือ Faculty ซึ่งเป็นหน่วย AI ผู้เชี่ยวชาญของ Accenture งานของ Faculty จะครอบคลุมการประเมินและ red-teaming โมเดล Claude การดำเนินการประเมินการจัดแนว และการทดสอบมาตรการป้องกันโมเดล Accenture ช่วยให้องค์กรและรัฐบาลปรับใช้ AI ในหลายอุตสาหกรรม ประสบการณ์การปรับใช้ในโลกแห่งความเป็นจริงนี้เป็นตัวกำหนดวิธีการประเมินความปลอดภัย ทั้งสององค์กรวางแผนที่จะลงทุนอย่างน้อย 1 พันล้านดอลลาร์ในแต่ละฝ่ายในช่วงห้าปีข้างหน้า เพื่อสร้างขีดความสามารถในด้านนี้
การประเมินแบบฝังตัวเป็นสิ่งใหม่ และยังไม่มีมาตรฐาน ปัจจุบันยังไม่มีกฎที่ตกลงกันไว้ว่าผู้ประเมินแบบฝังตัวควรเข้าถึงข้อมูลใด ควรรายงานผลการค้นพบอย่างไร หรือใครควรเป็นผู้ให้ทุนสนับสนุนงานนี้ Anthropic กำลังให้ทุนสนับสนุนงานของ Accenture โดยตรงในขณะนี้ ในขณะที่กำลังพัฒนารูปแบบการระดมทุนแบบรวมหรือจากรัฐบาลในระยะยาว ซึ่งเป็นไปตามที่ระบุไว้ในกรอบงาน AI ขั้นสูงของ Anthropic ในเดือนมิถุนายน METR และผู้ประเมินที่ไม่แสวงหาผลกำไรอื่นๆ ก็กำลังถูกนำร่องควบคู่กันไปภายใต้เงินทุนของตนเอง ความร่วมมือนี้ไม่ผูกขาด: Anthropic วางแผนที่จะทำงานร่วมกับผู้ประเมินเพิ่มเติม และ Accenture อาจทำงานร่วมกับนักพัฒนา AI รายอื่น
สำหรับทีมองค์กรที่ใช้ Claude นี่คือโครงสร้างความรับผิดชอบที่ตรวจสอบได้ Anthropic สามารถระบุได้ว่า Claude ปลอดภัย ตอนนี้องค์กรอิสระที่มีสิทธิ์การเข้าถึงในระดับพนักงานสามารถตรวจสอบข้อเรียกร้องนั้นได้ เป้าหมายคือระบบนิเวศของผู้ประเมินที่ทำงานด้วยมาตรฐานร่วมกัน ไม่ใช่การตรวจสอบครั้งเดียวที่ผ่านหรือไม่ผ่านโมเดล แต่เป็นการกำกับดูแลอย่างต่อเนื่องที่ฝังอยู่ในการสร้าง AI แนวหน้า
ประเด็นสำคัญ: ผู้ประเมินแบบฝังตัวจะได้รับสิทธิ์การเข้าถึงในระดับพนักงาน พวกเขาเฝ้าดูการฝึกอบรม ติดตามการตัดสินใจ และพูดคุยกับพนักงาน Faculty (หน่วย AI ของ Accenture) จะครอบคลุมการ red-teaming การประเมินการจัดแนว และการทดสอบมาตรการป้องกัน ทั้งสององค์กรวางแผนลงทุนอย่างน้อย 1 พันล้านดอลลาร์ในแต่ละฝ่ายในช่วงห้าปี ยังไม่มีมาตรฐานสำหรับการประเมินแบบฝังตัว Anthropic กำลังให้ทุนสนับสนุน Accenture โดยตรงในขณะที่กำลังพัฒนารูปแบบระยะยาว ความร่วมมือนี้ไม่ผูกขาด และจะมีการประกาศผู้ประเมินเพิ่มเติม