구글이 코딩과 사이버 보안 분야에서 경쟁사를 능가하는 성능을 갖췄다고 주장하는 차세대 인공지능(AI) 모델 '제미나이 4 아르곤'을 공개했다. 다만 안전성을 이유로 당분간 일반 접근은 제한한다.
30일(현지시간) 파이낸셜타임스(FT)와 AFP통신 등에 따르면 구글은 지난 2월 '제미나이 3.1 프로'를 내놓은 이후 약 7개월 만에 최상위 모델을 이같이 선보였다.
구글은 이 모델이 복잡하고 장기적인 업무 흐름 전체를 이해하고 추론하기 때문에 코딩을 비롯해 금융, 법률, 세무 등 전문 지식 업무나 사이버 보안 등 분야에서 역량을 발휘할 수 있다고 소개했다. 제미나이 4 아르곤은 코딩 능력을 측정하는 '딥SWE v1.1'과 '바이브코드 벤치' 등 성능지표에서 경쟁사인 오픈AI와 앤트로픽 모델을 능가하는 점수를 받았다.
특히 AI 모델이 한 번에 참조할 수 있는 데이터의 양을 의미하는 '컨텍스트 윈도'를 기존보다 16배 확대했다. 이를 통해 복잡한 추론과 장시간에 걸친 다단계 작업을 수행하는 능력을 강화했다.
구글에 따르면 초기 테스트 담당자들은 아르곤을 사용해 전 세계 병원에서 사용하는 소프트웨어의 결함을 발견했다. 이 결함은 민감한 개인 정보를 노출시키는 것으로 다른 고급 모델들은 놓쳤던 부분이다.
이번 신제품은 당초 출시 예정이었던 제미나이 3.5 프로를 건너뛰고 공개됐다. 구글은 지난 5월 3.5 프로 출시를 예고했지만 학습 기간이 예상보다 길어지고 성능도 기대에 미치지 못하자 개발을 중단한 것으로 알려졌다. 반면 아르곤의 개발이 예상보다 빠르게 진행되면서 신제품 출시로 방향을 전환했다.
다만 구글은 이 모델의 성능이 높아진 만큼 오남용 위험도 커졌다면서 일반 이용자의 접근은 당분간 막기로 했다. 구글은 자사가 주도하는 보안 계획인 '페어윈드 프로그램'을 통해 검증된 사이버 보안 전문가들에게 모델을 우선 제공할 방침이다.
구글 딥마인드를 이끄는 코레이 카부크추오을루 수석부사장(SVP)은 모델을 발표하는 블로그 게시물에서 "이러한 수준의 최첨단 기능을 안전하게 공개하기 위해서는 단계적인 접근 방식이 필요하다"며 "미국 정부에 해당 모델에 대한 조기 접근 권한을 자발적으로 제공하고, 널리 배포하기 전에 테스터들로부터 피드백을 수집할 것"이라고 밝혔다.
이 같은 출시 전략은 경쟁사인 앤트로픽의 접근 방식과 유사하다. 앤트로픽은 가장 진보된 모델인 클로드 미토스 프리뷰를 소수의 신뢰할 수 있는 조직에만 제한적으로 제공해 왔다. 미국 정부는 지난 6월 앤트로픽이 공개한 클로드 미토스와 클로드 페이블모델에 대한 접근을 일시적으로 중단하도록 강제했고, 이후 가장 강력한 AI 모델을 출시 전에 검증하는 자발적인 절차를 마련했다.