Anthropic은 9월 18일 Accenture의 AI 전문 조직 Faculty와 함께 모델 평가·레드팀·정렬 평가·안전장치 시험을 진행하는 내재 평가 파트너십을 발표했습니다. 평가자는 직원과 비슷한 접근 범위에서 모델이 만들어지는 과정과 배포 의사결정을 관찰할 예정입니다.
공식 발표도 접근 범위와 보고 기준, 장기 재원 구조가 아직 확정되지 않았다고 밝힙니다. 평가 조직의 독립성, 공개 범위, 이해상충 관리와 발견 사항의 시정 책임을 계약과 운영 절차로 분명히 해야 합니다.




