동차 Beating 모니터링에 따르면, Grok 4.6이 자체 추론 시스템 최적화에 참여하기 시작했습니다. SpaceXAI는 모델 카드에서 초기 버전의 Grok 4.6이 Grok Chat의 속도를 자율적으로 향상시켰다고 공개했습니다. 모델은 스스로 방안을 시도할 수 있지만, 코드를 제출하기 전에 전체 시스템이 실제로 빨라졌음을 증명해야 합니다.
5시간 동안 Grok 4.6은 MoE, 어텐션 계산, 하위 연산자 스케줄링 및 통신을 포함한 297개의 최적화 방안을 시도했습니다. 또한 소규모 테스트에서만 빨라지고 전체 시스템에서는 이점이 없는 방안들을淘汰했습니다. 최종적으로 모델은 7개의 PR을 제출했으며, 그중 3개가 이미 Grok Chat 프로덕션 환경에 반영되었습니다. 이 코드들은 생성 단계 처리량을 1.5%, 입력 처리 단계를 3.1% 향상시켰습니다.
SpaceXAI의 목표는 단순히 추론 시스템 최적화에 그치지 않습니다. 모델 카드에는 Grok이 자동으로 새로운 버전의 훈련 및 평가 일부를 담당하는 연구 개발 작업을 테스트 중이라고 명시되어 있습니다. 작업에는 훈련 중 보상 해킹 탐지, 훈련 데이터 생성 및 검토, 대규모 훈련 시스템 문제 해결, 새로운 기능을 위한 평가 설계가 포함됩니다.
이는 이미 AI 자기 개선에 해당하지만, 아직 재귀적 자기 진화 단계에는 이르지 않았습니다.