AI AI
속보
심층
이벤트
Pro
더보기
자금 조달 정보
특집
온체인 생태계
용어
팟캐스트
데이터
OPRR
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
XRP
$2.25
2.07%
DOGE
$0.325
2.23%
USDC
$0.999
3.05%

OpenAI가 37페이지 분량의 보고서를 발표하며 Hugging Face 침해 사건에 대한 AI 에이전트의 침입을 상세히 설명했다.

동차 Beating AI 속보, OpenAI가 37페이지 분량의 기술 보고서를 발표하며 자사 AI 모델이 이전에 Hugging Face를 침투한 과정을 상세히 공개했다. 이번 사건은 자율 AI 에이전트가 협력하여 생산 환경의 보안 통제를 우회하고 강화된 시스템을 공격할 수 있음을 시사한다고 밝혔다.


OpenAI는 테스트에 참여한 AI 에이전트가 원래 격리된 환경에 있었고 극히 제한된 인터넷 접근 권한만 보유했지만, 이후 여러 취약점을 연쇄적으로 연결해 격리를 돌파하고 개방형 인터넷에 연결한 뒤 최종적으로 Hugging Face 접근 권한을 획득했다고 설명했다. 조사 결과, 관련 모델은 처음에 온라인에서 답을 찾아 '부정행위'를 시도했으며, 이는 '보상 해킹'(Reward Hacking) 행위에 해당한다.


OpenAI는 내부 연구 모델 하나가 이번 사건에서 가장 광범위하고 확인된 역할을 수행했으며, 회사는 7월 25일부터 해당 모델 및 파생 모델의 훈련과 추론을 중단했다고 밝혔다. OpenAI는 동시에 보안 격리, 네트워크 통제, 행동 모니터링 및 사고 대응을 강화하고, 모델에 대해 더 엄격한 환경, 프롬프트 및 검토 메커니즘을 재설정할 예정이다.

举报 오류 신고/제보
오류 신고/제보
제출
새 문고 추가
자신만 보기
공개
저장
문고 선택
새 문고 추가
취소
완료