2026년 10월 6일 기준 — 구글 공식 블로그와 국내 언론 보도로 확인한 내용을 정리했습니다. 공개 일정과 가격은 언제든 바뀔 수 있으니 이용 전 공식 페이지에서 최신 정보를 확인하세요.

2026년 9월 30일, 구글이 차세대 최상위 모델 ‘제미나이 4 아르곤’을 공개했습니다. 지난 2월 제미나이 3.1 프로 이후 약 7개월 만에 나온 최전선(frontier) 모델입니다. 짧은 질문에 답하는 챗봇보다, 몇 시간씩 이어지는 복잡한 작업을 끝까지 해내는 데 초점을 맞췄습니다.

성능 다음으로 많이 나오는 질문은 “그래서 나도 쓸 수 있나"입니다. 결론부터 말하면 아직 아닙니다. 이 글에서는 무엇이 달라졌는지, 가격은 얼마인지, 언제부터 누가 쓸 수 있는지, 그동안 대신 쓸 모델은 무엇인지 순서대로 정리합니다.

빠른 답 — 먼저 궁금한 세 가지

1. 제미나이 4 아르곤이 뭔가요? 구글이 9월 30일 공개한 최상위 AI 모델입니다. 대규모 코드 작업, 법률·금융 문서 검토, 보안 취약점 점검처럼 길게 이어지는 작업을 견디도록 만들었습니다. 한 번에 출력할 수 있는 토큰 한도도 기존 6만 4천 개에서 100만 개로 늘었습니다.

2. 지금 쓸 수 있나요? 아직 아닙니다. 보안 전문가를 대상으로 한 페어윈드 프로그램을 시작으로, 유료 API 고객과 구글 AI 울트라 구독자, 개발자·기업, 일반 이용자 순으로 단계적으로 열릴 예정입니다. 일반 공개 시점은 아직 발표되지 않았습니다.

3. 가격은 얼마인가요? API 기준 출시 특가로 입력 100만 토큰당 2달러, 출력 100만 토큰당 10달러입니다. 특가가 끝나면 입력 4달러·출력 20달러로 오릅니다. 특가 종료 시점은 공개되지 않았습니다.

제미나이 3.5 프로를 건너뛴 4세대

아르곤은 예고 없이 나온 모델이 아닙니다. 구글은 5월 개발자 행사에서 제미나이 3.5 프로를 소개하고 6월 출시를 계획했지만, 실제로는 3.5 프로를 건너뛰고 4세대로 직행했습니다. 전자신문은 안전장치를 강화하고 코딩 성능을 다듬는 과정에서 방향이 아르곤으로 바뀌었다고 전했습니다. 시사저널e는 지난 1년간 보급형 플래시 모델에 집중했던 구글이 최상위 모델 경쟁에 복귀한 것으로 분석했습니다.

모델을 소개한 구글 공식 블로그 글은 구글 딥마인드의 코라이 카바쿠오글루 CTO 겸 수석 AI 아키텍트가 썼습니다. 구글은 복잡하고 긴 작업 흐름 전반을 깊이 추론하도록 만든 모델이라고 설명합니다.

핵심 변화는 세 가지입니다.

항목내용
겨냥한 작업소프트웨어 엔지니어링, 법률·금융 등 기업 지식 업무, 사이버보안 방어
출력 토큰 한도100만 개 (기존 6만 4천 개에서 약 16배, 구글 기준 업계 최고)
보안 특성취약점을 스스로 찾아 검증하고 고치는 능력을 학습, 보안 전문가에게는 가드레일을 끈 버전 제공

출력 한도가 100만 토큰으로 늘어난 것은 실무에서 의미가 큽니다. 지금까지는 코드베이스 전체를 고치거나 긴 보고서를 한 번에 내보내려면 작업을 잘게 쪼개야 했지만, 이 한도에서는 한 번의 출력으로 끝낼 수 있는 범위가 크게 넓어집니다.

구글이 공개한 내부 활용 사례도 눈에 띕니다.

  • 양자 알고리즘 최적화 — 기존 공개 베이스라인보다 40% 이상 나은 결과를 몇 분 만에 냈습니다.
  • 데이터센터 메모리 절감 — 프로파일링 분석으로 300TiB 이상을 확보했고, 최종적으로 500TiB에서 1PiB까지 줄일 수 있을 것으로 구글은 추산합니다.
  • C/C++에서 러스트로 전환 — re2, libgav1처럼 수만 줄 규모의 라이브러리부터 80만 줄이 넘는 퓨시아 OS 지르콘 커널까지 옮겼습니다. libgav1에서는 3만 2천 줄의 SIMD 코드를 대체해, 기존 러스트 버전보다 2.7배 빠른 디코더를 만들었습니다.
  • 보안 취약점 발견 — 보안 업체 위즈(Wiz)가 병원용 의료 소프트웨어에서 이전 최전선 모델들이 놓쳤던 치명적 취약점을 이 모델로 찾아냈습니다.

성능 — 구글이 공개한 지표

구글은 아르곤이 자체 평가 항목 대부분에서 경쟁 모델보다 앞서거나 같은 성적을 냈다고 밝혔습니다. 주요 수치를 경쟁 모델과 나란히 놓으면 아래와 같습니다.

평가 항목제미나이 4 아르곤GPT-6 아스트라클로드 오퍼스 5.5클로드 페이블 5.1
DeepSWE v1.1 (장기 코드 작업)77.9%74.1%74.2%67.4%
Vals Index68.9%63.1%67.0%65.8%
Vals Finance Agent v265.4%53.5%58.6%58.9%
AutomationBench (업무 자동화)51.3%41.4%42.5%—
CWE-bench v1 (취약점 대응)68% (공동 1위)68%67%58%

구글이 공개한 비교표를 기가진이 정리한 수치입니다.

구글 공식 블로그가 별도로 강조한 지표도 있습니다. 장편 영상 이해를 평가하는 LVBench에서 91.7%로 최고 점수를 냈고, 간접 프롬프트 인젝션 공격에 얼마나 버티는지 보는 그레이 스완 평가에서는 공격 성공률 0.7%로 비교 모델 중 가장 낮았습니다.

다만 모든 항목에서 1위는 아닙니다. 구글 비교표 안에서도 FrontierSWE v2는 아르곤이 55.0%로 GPT-6 아스트라(65.5%)와 클로드 오퍼스 5.5(62.3%)에 뒤졌고, 터미널 벤치마크 4에서는 약 57%로 클로드 소넷 5.5(64%)보다 낮았습니다. 어떤 작업을 맡기느냐에 따라 순위가 갈린다는 뜻입니다.

벤치마크와 실제 체감이 다르다는 지적도 나왔습니다. 포춘은 구글 내부 직원 일부가 벤치마크 점수는 높지만 실제 코딩 작업에서는 실망스럽다는 반응을 보였다고 전했습니다. 구글은 이런 평가가 부정확하다고 반박했습니다.

가격 — 출시 특가와 정가

구분입력 (100만 토큰)출력 (100만 토큰)캐시 입력
출시 특가2달러10달러입력가 대비 95% 할인
특가 종료 후4달러20달러동일 할인 유지

출시 특가 가격은 최상위 모델 치고 낮은 편입니다. 오픈AI의 GPT-6 아스트라는 입력 10달러·출력 50달러이고, 27만 2천 토큰을 넘는 요청에는 요금이 더 붙습니다. 시사저널e는 아르곤의 특가가 아스트라의 5분의 1 수준이라고 전했습니다. 특가가 끝난 뒤의 정가도 아스트라보다 낮습니다. 한국일보는 정가가 앤트로픽의 주력 모델 오퍼스 5.5와 같은 수준이라고 보도했습니다.

정리하면 이런 구도입니다.

모델입력 (100만 토큰)출력 (100만 토큰)비고
제미나이 4 아르곤2달러 → 4달러10달러 → 20달러캐시 입력 95% 할인
GPT-6 아스트라10달러50달러27만 2천 토큰 초과 시 인상
클로드 오퍼스 5.54달러20달러한국일보 보도 기준

개발자 입장에서는 같은 작업을 더 낮은 비용으로 돌릴 수 있는 선택지가 하나 늘어난 셈입니다. 다만 특가가 언제 끝날지 모르는 만큼, 도입을 검토한다면 정가 기준으로 비용을 계산해 두는 편이 안전합니다.

언제부터 쓸 수 있나

아르곤은 성능이 아니라 접근 순서 때문에 화제가 됐습니다. 공개 첫날부터 아무나 쓸 수 있었던 이전 모델들과 다릅니다.

  1. 1단계 — 보안 전문가. 구글은 ‘페어윈드 프로그램’에 참여하는 신뢰할 수 있는 사이버 보안 기관에 아르곤을 먼저 제공합니다. 이 기관과 구글 내부 팀에는 사이버 가드레일을 적용하지 않은 버전이 제공됩니다.
  2. 2단계 — 유료 API 고객과 AI 울트라 구독자. 구글 공식 블로그는 이들을 시작으로 공개 범위를 넓힌다고 밝혔습니다. 시점은 아직 정해지지 않았습니다.
  3. 3단계 — 개발자·기업, 일반 이용자. 순다르 피차이 CEO는 “가능한 한 빠르고 안전하게 공급 범위를 확대하겠다"고 밝혔지만, 구체적인 일정은 나오지 않았습니다.

공개가 늦어지는 것은 이 모델의 취약점 탐지 능력이 그만큼 강력하기 때문입니다. 미국 정부의 사전 출시 모델 접근 절차에도 참여해 검증을 받고 있습니다. 구글은 프롬프트 인젝션 방어, 실행 중단이 가능한 행동 감시, 샌드박스 격리, 악용 요청 거부 등 네 갈래 안전장치를 적용했다고 설명합니다.

한국 이용자도 같은 순서를 따릅니다. 구글 AI 울트라 구독자에게 먼저 열리고, 일반 사용자 공개는 그 이후입니다. 국내 제공 시점은 발표되지 않았습니다. 요금제별 가격과 기능 차이는 ChatGPT vs Gemini vs Claude 비교 총정리에서 확인할 수 있습니다.

지금 대신 쓸 수 있는 모델

아르곤을 기다리는 동안 지금 바로 쓸 수 있는 구글 모델과 경쟁 모델은 다음과 같습니다.

상황추천 모델확인할 글
구글 모델을 API로 저렴하게 쓰고 싶다제미나이 3.8 플래시Gemini 3.8 Flash 가격·사용법 총정리
가장 강한 오픈AI 모델이 필요하다GPT-6 아스트라GPT-6 아스트라 가격·사용법 총정리
긴 문서·코드 작업을 안정적으로 하고 싶다클로드 페이블 5.1클로드 페이블 5.1 가격·사용법 총정리
요금제를 통째로 비교하고 싶다세 모델 전부ChatGPT vs Gemini vs Claude 비교 총정리
학습·문서 요약에 구글 AI를 쓰고 싶다제미나이 노트북제미나이 노트북 가격·무료 한도 총정리

자주 묻는 질문

일반인도 무료로 쓸 수 있나요? 아니요. 현재는 페어윈드 프로그램에 참여하는 보안 기관만 쓸 수 있습니다. 이후 공개도 유료 API 고객과 AI 울트라 구독자부터이고, 무료 플랜 제공 여부는 아직 발표된 내용이 없습니다.

출시 특가는 언제까지 유지되나요? 종료 시점이 공개되지 않았습니다. 구글 공식 블로그는 특가가 끝나면 입력 4달러·출력 20달러의 정가가 적용된다고 명시했습니다.

제미나이 3.8 플래시와 무엇이 다른가요? 3.8 플래시는 속도와 비용을 앞세운 보급형 라인이고, 아르곤은 성능을 최우선으로 한 최상위 라인입니다. 아르곤은 이전 세대의 출력 한도 6만 4천 토큰을 100만 토큰으로 늘렸고, 장기 코드 작업과 금융 분석, 취약점 대응 평가에서 더 높은 점수를 냈습니다. 3.8 플래시의 가격과 무료 한도는 별도 가이드에 정리해 두었습니다.

GPT-6 아스트라보다 성능이 좋은가요? 구글 비교표에서는 DeepSWE v1.1을 비롯한 여러 항목에서 앞섰지만, FrontierSWE v2와 터미널 벤치마크 4에서는 뒤졌습니다. 평가 항목에 따라 순위가 갈리므로, 실제로 맡길 작업이 무엇인지에 따라 판단해야 합니다.

일반 공개는 왜 이렇게 늦어지나요? 구글은 취약점 탐지 능력이 악용될 수 있다고 보고, 사이버 보안 기관에 먼저 제공하며 안전장치를 다듬는 중이라고 밝혔습니다. 유료 API 고객과 AI 울트라 구독자 공개 시점도 아직 정해지지 않았습니다.

출처