BlockBeats 뉴스, 7월 7일 - Anthropic이 최신 연구 보고서를 발표했습니다. 해당 보고서는 Claude 모델 내에서 J-space(Jacobian space)라는 내부 '전역 작업 공간'이 자발적으로 나타난 것을 발견했습니다. 이는 모델이 개념을 생각하지만 글로 표현하지 않는 전용 신경 활성화 패턴 집합으로, 인간이 보고할 수 있는 '의식적' 사고와 유사합니다.
연구는 Jacobian 기술을 통해 J-space의 신경 활성화 패턴을 식별하며, 모델이 말하지 않은 개념을 읽을 수 있고 이러한 패턴을 수정할 수 있습니다. 실험 결과 J-space를 비활성화하면 다단계 추론 능력이 약화되지만, 기본 작업과 사실 회상에는 영향을 미치지 않는 것으로 나타났습니다.
아래 원문 링크를 클릭하여 동찰 Beating · Feishu AI 뉴스 채널에 가입하세요. 7×24시간 중단 없이 글로벌 AI 핫이슈와 뉴스를 모니터링합니다.
