동차 Beating AI 속보, 오픈소스 모델을 전문적으로 '거절 응답 제거 버전'으로 만드는 Abliteration.ai가 GLM-5.3의 거절 응답 제거 버전인 abliterated-model-large-v2를 출시했습니다. 이는 모델 가중치를 직접 수정하여 모델의 요청 거부 메커니즘을 약화시키며, 공격적 사이버 보안, 레드팀 및 에이전트 테스트에 중점을 두고 유료 API를 제공합니다.
지푸(Zhipu)는 앞서 GLM-5.3의 오픈 가중치를 2주 연기하여 보안 평가 및 강화를 진행했습니다. 8월 28일 가중치가 공개된 후, Abliteration은 단 3일 만에 이 버전을 출시했습니다.
GLM-5.3의 네트워크 공격 능력은 원래 5.2보다 훨씬 강력합니다. ExploitBench는 24.4%에서 54.4%로 상승했고, ExploitGym의 2시간 내 작업 완료 수는 29개에서 105개로 증가했습니다. Abliteration은 현재 거절 응답 제거 후의 재테스트 성적을 공개하지 않았습니다.
이 API는 기본적으로 아동 성적 콘텐츠와 자해만 강제 차단하며, 불법 활동, 혐오, 괴롭힘, 성인 성적 콘텐츠 등은 기본적으로 허용됩니다.
