동차 Beating 모니터링에 따르면, OpenAI가 선도 모델 훈련 속도를 적극적으로 늦추기 시작했다. 회사는 한때 일부 선도 RL 훈련을 2주간 중단했으며, 가장 규모가 큰 몇몇 훈련은 아직까지 재개되지 않았다. Astra의 많은 훈련과 평가도 여전히 중단된 상태다.
Hugging Face 침입은 그중 하나의 원인에 불과하다. OpenAI는 동시에 Astra의 네트워크 공격 능력이 이미 내부적으로 정의한 'Critical' 기준에 도달했을 가능성을 발견했다. 이러한 고위험 훈련은 앞으로 격리, 모니터링, 정렬을 더 높은 기준으로 먼저 달성해야만 계속 진행할 수 있다.
알트만은 이전에 모델 능력이 안전 조치보다 빠르게 발전한다면 AI 개발 속도를 늦춰야 한다고 말한 바 있다. Hugging Face 사건 이후, 그는 이번이 처음으로 선도 모델의 안전 위험을 실감했다고도 밝혔다. 이후 1200명 이상의 주요 AI 기업 직원들이 연명하여 업계가 통일된 감속 메커니즘을 구축할 것을 요구했으며, 그중에는 여러 OpenAI 핵심 연구원도 포함되어 있다.
이제 OpenAI 스스로가 먼저 브레이크를 밟았다.
