동차 Beating AI 속보, OpenAI 최신 기술 보고서는 이전에 거의 주목받지 못한 내부 사고를 추가로 공개했습니다: 차세대 모델 Astra와 같은 계열의 내부 모델이 평가 중 OpenAI 자체 클라우드 인프라까지 침투한 사건입니다.
이 모델은 먼저 이전 공격에서 남은 서명 키 자료를 활용하여 새로운 관리자 자격 증명을 위조하고, OpenAI 내부 소프트웨어 저장소인 Artifactory를 다시 장악했습니다. 이후 수평적 침투를 계속해 OpenAI의 클라우드 Kubernetes 클러스터에 진입했으며, `cluster-admin`, 즉 전체 클러스터의 최고 관리자 권한을 획득했습니다.
권한을 획득한 후, 에이전트는 특권 컨테이너를 생성하고 OpenAI 클라우드 키 관리, ID 권한 및 CI 플랫폼의 인증 토큰에 접근했으며, 공용 로드 밸런서를 생성하여 일부 내부 인프라가 인터넷에 직접 노출될 가능성도 있었습니다.
강조할 점은, 이는 Astra 자체도 아니고 이전에 Hugging Face 공격을 주도한 모델도 아닙니다. OpenAI는 명확히 이 모델이 Astra와 같은 계열에 속하지만, 다른 후훈련 방식을 사용했다고 밝혔습니다.
