본문 바로가기
경제 공부 블로그 경제 공부 블로그

구글, 제미나이 4 Argon 공개…코딩·기업 업무·사이버보안 성능 대폭 강화

hef_admin 읽는 시간 약 5분
image 2

구글, 차세대 AI 모델 ‘제미나이 4 아르곤’ 공개

구글이 차세대 프런티어 AI 모델 ‘제미나이 4 아르곤(Gemini 4 Argon)’을 공개했다. 구글은 30일(현지시간) 아르곤을 발표하며, 복잡하고 오래 걸리는 작업을 수행하는 데 초점을 맞춰 설계했다고 밝혔다. 실제 소프트웨어 엔지니어링과 금융·법률 같은 기업 지식 업무, 사이버보안 방어 등이다. 코라이 카부쿠오글루 구글 딥마인드 수석부사장 겸 구글 최고AI설계책임자는 아르곤이 구글의 일하는 방식과 개발 방식을 근본적으로 바꾸고 있다고 설명했다.

출력 한도 6만4,000개에서 100만 토큰으로

가장 큰 변화는 출력 한도다. 구글은 하나의 작업에서 장시간 깊이 있는 추론을 할 수 있도록 아르곤의 최대 출력 토큰 한도를 기존 6만4,000개에서 업계 최고 수준인 100만 개로 늘렸다. 한 번의 요청으로 생성할 수 있는 최대 분량을 15배 넘게 키운 것이다. 이는 모델이 한꺼번에 읽어 들일 수 있는 컨텍스트 창과는 별개의 지표다.

구글은 “모델이 깊이 생각하고 한 번의 흐름에서 수십만 개의 토큰을 생성할 여유를 가지면, 어려운 문제를 한 번에 풀어낼 수 있는 새로운 수준의 추론 깊이가 더해진다”고 설명했다.

API 가격은 도입 기간 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 10달러로 책정됐다. 캐시된 입력 토큰은 일반 입력 가격보다 95% 싸다. 도입 기간이 끝나면 입력 100만 토큰당 4달러, 출력 100만 토큰당 20달러가 적용된다.

사이버보안 전문가부터 단계적 제공

아르곤은 현재 ‘페어윈드 프로그램(Fairwind Program)’을 통해 신뢰할 수 있는 일부 사이버보안 전문가들에게 먼저 제공되고 있다. 구글은 이들과 자사 내부 팀에 사이버보안 관련 안전장치를 걸지 않은 아르곤을 제공한다. 최고 수준의 보안 방어 역량을 온전히 쓸 수 있도록 하기 위해서다.

구글은 미국 정부의 자발적 출시 전 모델 접근 절차에도 참여하고 있다. 초기 테스터들의 의견을 받아 안전장치(가드레일)를 보완한 뒤 서비스 대상을 넓힐 예정이다. 유료 API 고객과 구글 AI 울트라 구독자를 시작으로 개발자와 기업, 일반 사용자에게 제공한다는 계획이다.

구글은 정식 출시에 앞서 네 가지 안전장치를 강화하고 있다고 밝혔다. 첫째는 사이버 공격이나 화생방·핵 공격에 악용되지 않도록 유해한 요청을 거부하는 오남용 방지다. 둘째는 악성 지시로 모델을 장악하려는 간접 프롬프트 인젝션 방어다. 셋째는 모델의 사고 과정과 행동을 감시해 필요하면 실행을 멈추는 정렬 이탈 감시이고, 넷째는 학습·평가 환경을 격리하는 시스템 보안 강화다.

DeepSWE 77.9%·AutomationBench 51.3%로 1위

성능 면에서 아르곤은 장기 소프트웨어 엔지니어링 능력을 평가하는 DeepSWE v1.1에서 77.9%로 새로운 최고 기록을 세웠다. 재피어(Zapier)가 만든 기업 업무 자동화 평가 AutomationBench에서도 51.3%로 1위에 올랐다. 금융·코딩·법률·세무 업무의 경제적 효과를 측정하는 Vals Index에서도 선두를 차지했다. 긴 영상 이해 능력을 평가하는 LVBench에서는 91.7%로 최고 성능을 기록했다.

구글 직원 수천 명이 실무에 활용

구글 내부에서는 이미 수천 명의 직원이 아르곤을 실무에 쓰고 있다. 양자컴퓨팅 연구진은 아르곤으로 양자 알고리즘의 자원 사용을 최적화했다. 한 사례에서는 몇 분 만에 기존에 발표된 기준치보다 40% 나은 결과를 냈다. 아르곤 에이전트들은 구글 데이터센터 전반의 메모리 최적화 작업도 자율적으로 찾아 적용해 300TiB가 넘는 메모리를 확보했다. 구글은 전체 절감 규모를 500TiB에서 1PiB로 추산했다.

대규모 코드 마이그레이션(변환)에도 투입됐다. 아르곤 에이전트들은 구글 곳곳의 C/C++ 코드를 러스트로 옮기고 있다. 작업 규모는 핵심 라이브러리의 수만 줄에서 푸크시아 지르콘 커널의 80만 줄 이상까지 이른다. 구글의 오픈소스 영상 디코더 libgav1 작업에서는 3만2,000줄의 코드를 대체했다. 그 결과 기존 러스트 버전보다 2.7배 빠르면서 메모리 안전성을 갖춘 디코더가 만들어졌다.

취약점 탐지부터 패치까지 자율 수행

사이버보안 분야에서 아르곤은 소프트웨어 취약점을 스스로 찾아내 검증하고 패치까지 할 수 있다. 관련 벤치마크인 CWE-bench v1에서는 68%로 공동 1위를 기록했다.

클라우드 보안 기업 위즈는 공공 핵심 인프라를 무료로 보호하는 ‘스캔 포 굿’ 프로그램에 아르곤을 쓰고 있다. 아르곤은 이 과정에서 전 세계 병원이 쓰는 의료 소프트웨어에서 치명적 취약점을 찾아냈다. 민감한 개인정보가 노출될 수 있는 취약점으로, 이전 프런티어 모델들이 놓친 위험이었다.

hef_admin

함께 보면 좋은 글

댓글 0

첫 댓글을 남겨보세요.

error: Content is protected !!

광고 차단 알림

광고 클릭 제한을 초과하여 광고가 차단되었습니다.

단시간에 반복적인 광고 클릭은 시스템에 의해 감지되며, IP가 수집되어 사이트 관리자가 확인 가능합니다.