구글이 복잡하고 장시간 이어지는 프로젝트 수행에 특화된 새로운 AI 모델 ‘제미나이 4 아르곤(Gemini 4 Argon)’을 공개했다.

제미나이 4 아르곤은 단순한 질문이나 짧은 작업보다 소프트웨어 개발과 연구, 금융·법률 업무처럼 여러 단계를 거쳐 장시간 수행해야 하는 작업에 초점을 맞춘 모델이다.
이를 위해 구글은 장시간 추론 능력을 강화하고, 하나의 작업에서 장시간 추론을 이어갈 수 있도록 기존 6만4000개였던 최대 출력 토큰을 100만개까지 확대했다. 이를 통해 대규모 코드 분석과 수정, 자료 조사처럼 여러 단계가 필요한 작업을 중간에 끊지 않고 수행할 수 있다.
실제 구글 내부에서도 제미나이 4 아르곤을 다양한 장기 프로젝트에 활용하고 있다. 양자 컴퓨팅에서는 주요 알고리즘의 시공간 자원을 최적화해 기존 기준보다 40% 이상 개선된 결과를 수분 만에 찾아냈으며, 데이터센터 서버 분석을 통해 300TiB 이상의 메모리를 확보했다.

소프트웨어 개발에서는 수만줄 규모의 라이브러리부터 80만줄 이상인 Fuchsia OS의 Zircon 커널까지 C/C++ 코드를 Rust로 변환하는 데 활용되고 있다. 실제 장기 소프트웨어 엔지니어링 능력을 평가하는 DeepSWE v1.1에서는 77.9%로 최고 수준(SOTA)을 기록했으며 기업 업무 자동화 평가인 AutomationBench에서는 51.3%의 점수로 1위를 달성했다.
장시간 자율적으로 작업하는 만큼 보안 대책도 강화했다. 소프트웨어 취약점을 찾아 검증하고 패치할 수 있는 능력을 갖춘 동시에 사이버 공격이나 CBRN 관련 악용을 막기 위한 안전장치를 적용했다. 간접 프롬프트 인젝션에 대한 방어 능력을 강화하고, 모델이 사용자가 허용한 범위를 벗어난 작업을 수행하는지 감시, 필요할 경우 실행을 중단하는 기능도 마련했다.
제미나이 4 아르곤은 우선 페어윈드 프로그램을 통해 신뢰할 수 있는 사이버 보안 전문가에게 제한적으로 제공되며, 이후 유료 API 이용자와 Google AI Ultra 구독자를 시작으로 이용 대상을 확대할 예정이다.
출시 기념 가격은 입력 토큰 100만개당 2달러, 출력 토큰 100만개당 10달러이며, 캐시된 입력 토큰에는 95% 할인이 적용된다. 구글은 초기 사용자들의 피드백을 바탕으로 안전장치를 보완한 뒤 개발자와 기업, 일반 사용자까지 순차적으로 제공할 계획이다.
|