OpenAI는 9월 1일 Astra가 자사 Preparedness Framework에서 사이버 보안 ‘Critical’ 임계값에 도달했다고 발표했습니다. 공개·비공개 벤치마크와 전문가 평가에서 알려지지 않은 취약점을 발견하고 작동하는 공격 체인으로 연결하는 능력이 확인됐으며, 일부 취약점은 유지관리자에게 공개 절차를 진행하고 있다고 밝혔습니다.
OpenAI는 악의적 사용과 모델의 비인가 행동을 별도 위험 경로로 보고, 훈련 인프라 격리와 네트워크 통제, 강화된 모니터링, 거부 훈련, 작업을 자동 중단할 수 있는 감시 체계를 계층적으로 적용한다고 설명했습니다. 기능 접근은 초기에는 제한된 방어 목적 사용자에게 제공할 계획입니다.