동찰 Beating AI 속보, LLM 훈련과 CPU 형식 검증을 해본 엔지니어 Jay Kruer가 글을 올려, OpenAI가 수만 개의 Agent로 Navier-Stokes 난제를 공략했다고 해서 AI가 이미 독립적으로 지식 노동자를 대체할 수 있다는 뜻은 아니라고 밝혔다.
그의 핵심 근거는 간단하다: 수학 문제는 명확한 답이 있고 Lean으로 자동 검사도 가능하다. 현실의 프로그래밍, 연구, 기업 업무는 목표가 모호한 경우가 많고, 결과의 옳고 그름을 프로그램이 직접 판단할 수도 없다.
신뢰할 수 있는 자동 검사가 없으면 사람이 계속 AI를 지켜봐야 한다. 과제 규칙을 충분히 엄격하게 작성하려면 값비싼 도메인 전문가도 필요하다. Kruer는 이 감독과 검수 비용이 사람이 직접 일을 하는 것보다 오히려 더 클 수 있다고 본다.
그래서 그는 현재의 LLM을 「핵을 쓴 인턴」이라고 부른다: 능력은很强, 일도 빠르지만, 아직 안심하고 혼자 일을 맡길 수는 없다.