동찰 Beating AI 속보, OpenAI가 GPT-6 Astra에 configuration_update를 추가했습니다. Responses API의 동일한 긴 대화 내에서 이제 언제든지 reasoning effort를 높이거나 낮출 수 있으며, 이미 캐시된 Prompt 접두사를 다시 작성하지 않아도 됩니다. 어려운 문제는 High, xhigh로 설정하고, 간단한 작업은 다시 Low로 낮추면, 이전의 긴 컨텍스트를 계속 재사용할 수 있습니다.
이전에는 이 점이 매우 은밀한 비용 소모 구간이었습니다. reasoning effort는 컨텍스트 시작 부분의 명령으로 작동하여, 중간에 새로운 사고 단계로 전환하면 대량의 캐시를 더 이상 재사용할 수 없게 됩니다. Codex 사용자의 실제 테스트에 따르면, 단계를 전환한 후 캐시 적중률이 98.5%에서 65%로 떨어졌으며, 다음 라운드에서 캐시를 다시 구축한 후에야 97% 이상으로 회복되었습니다.
장시간 실행되는 Agent에게 이 변경은 매우 실용적입니다. 어려운 문제가 발생하면 일시적으로 사고 강도를 높일 수 있고, 간단한 작업에서는 다시 낮출 수 있어, 단순히 단계를 전환했다는 이유만으로 앞선 수십만 Token의 캐시가 일반 입력으로 다시 처리되지 않습니다.