구글은 지난 몇 달 동안 인공지능(AI) 분야의 선두주자로서 불안정한 상황 속에서도 새로운 전설을 만들어내고 있다. 이번에 구글은 7개월만에 최신 최상위급 AI 모델 ‘아르곤’을 공개했다. 이는 오픈AI의 ‘아스트라’와 앤스로픽의 ‘오퍼스’와 같은 경쟁 모델들과 경쟁할 전망이다.
구글이 발표한 ‘제미나이4 아르곤’ 모델은 지난 2월에 선보인 제미나이 4 프로 모델 이후 약 7개월 만에 출시된 새로운 플래그십 모델이다. 구글의 계획대로, 먼저 검증된 사이버보안 파트너들에게 아르곤을 제공하고 추가적인 테스트를 거쳐 유료 이용자 등으로 접근 범위를 확대할 예정이다.
아르곤의 주요 목표는 소프트웨어 엔지니어링, 금융, 법률과 같은 전문적인 업무 및 사이버보안 관련 복잡하고 지속적인 작업을 처리하는 데 있음을 구글은 명확히 밝혔다. 자체 벤치마크 시스템에서는 아르곤이 오픈AI의 ‘아스트라’와 앤스로픽의 ‘오퍼스’ 등 경쟁 모델들을 일부 영역에서 능가하는 것으로 나타났다. 외부 평가 결과에 따르면, 아스트라와 비슷한 수준의 성능을 보여주며 최상위권 AI 모델로 자리 잡았다.
특히 보안 취약점 관리 능력을 평가하는 시험에서 아르곤은 아스트라와 동급의 성능을 기록하며 최고 수준에 올랐다. 멀티모달 능력, 즉 영상에서 메타데이터를 추출하는 등 텍스트 외의 정보를 이해하고 자연스럽게 의사소통할 수 있는 능력과 안전성도 아르곤의 강점으로 평가된다. 한 번에 최대 100만 토큰까지 생성 가능한 긴 결과물을 제공하는 것도 이 모델의 특징이다.
구글은 AI 주도권 경쟁에서 중요한 전략적 승부처를 지키기 위해 아르곤 출시를 계획하고 있다. 구글의 핵심 서비스인 검색, 지도, 지메일, 크롬 등에 제미나이가 적용되어 있으며, 오픈AI와 앤스로픽이 자체 AI 에이전트 및 개발 도구를 통해 사업 범위를 빠르게 확장하고 있는 상황에서 구글도 최상위 기반 모델의 경쟁력을 강화하는 것이 절실한 시점에 이른다.
지난 5월에는 ‘제미나이3.5 프로’를 발표하고 6월 출시를 예정했으나, 목표 성능을 확보하지 못해 개발 중단으로 이어졌다는 보도가 있었다. 대형 AI 모델은 하나의 학습 단계에 수억 달러의 비용이 소요될 수 있기 때문에, 개발 지연은 시간과 경제적 부담으로 이어질 수 있다.
그럼에도 구글 내부에서는 아르곤이 코딩 성능에서 아스트라와 같은 경쟁 모델보다 떨어진다는 지적이 나오고 있다. 일부 직원들은 벤치마크에서의 점수가 높지만 실제 업무 환경에서는 특정 코딩 작업 성능이 기대에 못 미친다고 평가했다. 프런트엔드 개발, 즉 웹사이트나 애플리케이션 화면을 만들어내는 능력도 일관성이 없다는 지적이 제기되고 있다.
이러한 상황에서 구글은 실제 사용성보다 벤치마크 점수에 집중하는 ‘벤치맥싱’ 경향에 대한 비판을 받고 있지만, 구글은 이를 반박하며 아르곤의 코딩 성능 평가가 사실과 다르다고 주장한다. 구글 딥마인드 측도 아르곤이 최첨단 AI 모델 수준에 올라섰다는 입장을 분명히 하였으며, 코레이 카부쿠오글루 구글 딥마인드 책임자는 최근 “우리가 항상 최전선에 있을 것”이라고 자신감을 표현했다.
구글의 아르곤 출시는 AI 기술 발전에서의 또 다른 중요한 이정표를 의미한다. 전문적인 업무 처리와 사이버보안 강화에 특화된 이 모델은 구글이 지속해서 주도권을 잡기 위한 노력의 증거로 볼 수 있으며, AI 경쟁에서의 진자운동에 한 발짝 다가선 상황이다. 이 모델의 성능과 실제 응용 사례는 AI 기술의 미래 방향을 좌우하는 중요한 요소로 자리 잡을 것이다.



![[단독] 경기도 추미애 지사의 쿠팡 이용 현실화 – 업무추진비 속 논란과 대응](https://newsjjang.com/wp-content/uploads/2026/10/news-1791450972-20844.web_.jpg)

