
9월 30일 Google은 프로그래밍, 기업 작업 및 사이버 보안을 위한 플래그십 AI 모델 Gemini 4 Argon을 발표했습니다. 이 모델은 Fairwind 프로그램의 일환으로 제한된 보안 전문가 그룹에 의해 테스트되고 있습니다. Google은 미국 정부가 주관하는 최첨단 모델 검증 자발적 프로그램에 참여하고 있습니다.
주요 변화는 최대 출력량이 64,000에서 100만 토큰으로 증가한 것입니다. 시작 가격: 100만 개 입력 토큰당 2달러, 100만 개 출력 토큰당 10달러; 캐시 입력은 0.10달러입니다. 도입 기간 이후 요금은 4달러 및 20달러로 인상될 예정이며, Google은 일정은 공개하지 않았습니다. DeepSWE v1.1에서 모델은 77.9%를 기록했습니다. FrontierSWE v2에서는 55%로, GPT-6 Astra의 65.5% 및 Claude Opus 5.5의 62.3%와 비교됩니다. Vals Finance Agent v2에서는 65.4%, Zapier의 AutomationBench에서는 51.3%, LVBench에서는 91.7%입니다.
이 모델은 이미 수천 명의 Google 직원에 의해 사용되고 있습니다. 에이전트들은 데이터 센터의 작업을 분석하고 300TiB 이상의 메모리를 해제할 방법을 찾았습니다; 잠재적인 절약은 500TiB에서 1PiB에 이릅니다. 다른 직원들은 C/C++에서 Rust로 코드를 이식하는 데 도움을 주었으며, Fuchsia 시스템의 Zircon 커널은 80만 줄이 넘습니다. libgav1 Argon은 32,000줄의 SIMD 코드를 재작성했으며, Rust 버전은 2.7배 더 빠릅니다. 한 실험에서 모델은 양자 알고리즘 최적화를 40% 개선했습니다. 사이버 보안 분야에서는 Argon이 스스로 취약점을 찾아 수정하도록 훈련되었습니다. CWE-bench v1에서 pass@1은 68%로, GPT-6 Astra와 Grok 4.7과 동일합니다. Wiz는 Scan for Good 프로그램에서 모델을 테스트하고 있습니다. Argon은 환자 개인 데이터에 위협이 되는 의료 소프트웨어의 심각한 취약점을 발견했습니다. Google은 프롬프트 주입 및 사용자 의도에서 벗어나는 것을 방지하기 위한 보안을 강화하고 있습니다. Artificial Analysis에 따르면, Argon은 15%의 환각을 보이며, 이는 주요 모델 중 최소입니다.





