동찰 Beating AI 속보, Google DeepMind가 차세대 플래그십 모델 Gemini 4 Argon을 발표했습니다. 이 모델은 장기 복잡 작업에 특화되어 소프트웨어 엔지니어링, 금융 및 법률 업무, 그리고 사이버 보안을 아우릅니다. 모델은 아직 일반 사용자에게 공개되지 않으며, 첫 배치는 Fairwind Program을 통해 신뢰할 수 있는 사이버 보안 팀에만 제공됩니다. 이후 유료 API 고객과 Google AI Ultra 사용자에게 점진적으로 개방될 예정입니다.
Argon의 가장 큰 변화 중 하나는 출력 길이입니다. 단일 출력 상한이 기존 64K tokens에서 100만 tokens로 증가하여, 모델이 한 번의 작업에서 지속적으로 추론하고 더 긴 단계를 실행할 수 있게 되었습니다. Google은 내부적으로 이미 대규모 코드 마이그레이션, 알고리즘 최적화, 데이터센터 메모리 최적화에 이를 사용하고 있다고 밝혔습니다.
공식 평가에서 Argon은 DeepSWE v1.1에서 77.9%를 기록하여 GPT-6 Astra의 74.1%와 Claude Opus 5.5의 74.2%를 앞섰습니다. Vals Index와 AutomationBench에서도 1위를 차지했습니다. 그러나 전면적으로 앞서지는 못했으며, FrontierSWE, Terminal-Bench 4.0 및 일부 과학 작업에서는 여전히 GPT-6 Astra나 Claude Opus 5.5에 뒤처집니다.
Google은 또한 사이버 보안 능력을 중점적으로 강화했습니다. Argon은 소프트웨어 취약점을 자동으로 발견, 검증 및 패치할 수 있으며, 신뢰할 수 있는 방어 팀이 받는 버전은 일부 사이버 보안 제한을 해제하여 완전한 능력을 발휘할 수 있도록 합니다. 정식 출시 전에 Google은 남용, 프롬프트 인젝션, Agent 경계 초과 등의 위험을 계속 테스트하고 있습니다. API 출시 초기에는 백만 입력 tokens당 2달러, 출력 10달러로 과금되며, 이후 가격이 두 배로 올라 4달러와 20달러가 됩니다.