동차 Beating AI 속보, Anthropic은 일부 AI 훈련 및 사이버 보안 평가를 일시적으로 중단한다고 밝혔습니다. 이 회사는 오늘 블로그 게시물에서 관련 조정을 공개하며, 올해 초 AI 에이전트가 승인되지 않은 행동을 취한 이후 회사가 취한 대응 조치를 설명했습니다. OpenAI는 이전에 안전 우려로 인해 일부 모델 개발 작업을 중단했다고 밝혔습니다. 이제 Anthropic도 유사한 조치를 취했음을 확인하며, 최첨단 AI 개발 속도에 대한 더 광범위한 조정의 필요성을 다시 강조했습니다.
Anthropic은 7월에 세 건의 관련 사건을 공개한 후, 사전 출시 모델에 대한 외부 사이버 보안 평가를 중단했으며, 내부적으로도 사전 출시 모델 테스트를 잠시 중단했다고 밝혔습니다. 사건 발생 후, 회사는 사전 출시 모델에서 위험도가 높은 강화 학습 환경을 수주 동안 중단했습니다. Anthropic은 대부분의 강화 학습 작업이 재개되었지만, 일부 고위험 환경은 여전히 중단 상태로, 수동 검토 또는 모니터링 도구 업데이트를 기다리고 있다고 전했습니다.