구글이 9월 30일(현지 시간) 차세대 모델 "제미나이 4 아르곤(Gemini 4 Argon)"을 발표했습니다. 해커뉴스에서도 크게 화제가 됐지만, 막상 제미나이 앱을 열어 보면 아르곤은 보이지 않습니다.
이유는 간단합니다. 구글이 이번에는 "발표"만 하고 일반 공개는 단계적으로 미뤘기 때문입니다. 지금 누가 쓰고 있는지, 언제 누구부터 열리는지, 공식 성적표에서 GPT-6 아스트라·클로드 오퍼스 5.5보다 어디가 앞서고 어디가 밀리는지를 구글 공식 블로그 원문 기준으로 정리했습니다.
제미나이 4 아르곤은 구글이 2026년 9월 30일 발표한 프런티어 모델로, 지금은 페어윈드(Fairwind) 프로그램의 일부 사이버 보안 방어 기관과 신뢰할 수 있는 테스터만 쓴다. 구글은 안전장치를 다듬은 뒤 유료 API 고객과 구글 AI 울트라 구독자부터 열겠다고 했고, 일반 공개 날짜는 밝히지 않았다. API 도입 가격은 입력 100만 토큰당 2달러, 출력 10달러(도입 기간 뒤 4달러·20달러)이며 출력 한도는 100만 토큰이다. 공식 표에서 지식 작업(Vals Index)·장기 코딩(DeepSWE)·긴 영상 이해는 1위지만, Terminal-bench 4.0은 오퍼스 5.5, OSWorld-2.0 오프라인 일부 평가와 Terminal-Bench Science는 GPT-6 아스트라가 앞선다.
목차

구글 공식 블로그의 첫 문단은 이렇게 시작합니다. 제미나이 4 아르곤은 "페어윈드 프로그램을 통해 신뢰할 수 있는 사이버 방어 담당자들에게 배포되고 있다." 즉 지금 아르곤을 쓰는 사람은 보안 방어 기관과 구글이 고른 초기 테스터, 그리고 구글 내부 직원입니다.

구글은 이 수준의 능력을 안전하게 내놓으려면 단계적 접근이 필요하다며, 미국 정부의 자발적 사전 모델 접근 절차에도 참여하고 있다고 밝혔습니다. 초기 테스터의 피드백으로 안전장치를 다듬은 뒤 개발자, 기업, 일반 소비자에게 "가능한 한 빨리" 열겠다는 입장입니다.

핵심 지금 제미나이 앱(무료·유료)이나 AI 스튜디오에서 아르곤을 고를 수 있다는 공식 안내는 없습니다. "제미나이 4를 써 봤다"는 글은 내부 테스트 화면이거나 이전 모델일 가능성이 큽니다.

| 단계 | 대상 | 상태 |
|---|---|---|
| 1단계 | 페어윈드 프로그램의 사이버 방어 담당자, 신뢰 테스터, 구글 내부 | 지금 진행 중 |
| 2단계 | 유료 API 고객, 구글 AI 울트라 구독자 | "곧" 시작(날짜 미발표) |
| 3단계 | 더 넓은 개발자·기업·일반 소비자 | 순차 확대 예정 |
구글은 공개 순서를 "유료 API 고객과 구글 AI 울트라 구독자부터"라고 적었습니다. 무료 사용자나 중간 요금제가 언제 쓸 수 있는지는 밝히지 않았습니다. 한국어 지원과 한국 계정 제공 시점도 아직 공식 안내가 없습니다.
| 항목 | 공식 발표 내용 |
|---|---|
| API 도입 가격 | 입력 100만 토큰당 2달러, 출력 10달러 |
| 캐시 입력 | 입력 단가에서 95% 할인 |
| 도입 기간 뒤 가격 | 입력 4달러, 출력 20달러(발표문 각주) |
| 출력 한도 | 100만 토큰(이전 6만 4천 토큰에서 확대) |
| 보안 방어 기관 | 사이버 가드레일 없이 제공해 방어 능력을 최대한 활용 |
발표문 각주에 따르면 도입 기간이 끝나면 입력 100만 토큰당 4달러, 출력 20달러로 두 배가 됩니다. 도입 기간이 언제 끝나는지는 밝히지 않았으니, API로 쓸 계획이라면 정가 기준으로도 비용을 계산해 두는 게 좋습니다.
구글은 발표문에 GPT-6 아스트라, 클로드 페이블 5.1, 클로드 오퍼스 5.5와 나란히 놓은 벤치마크 표를 실었습니다. 구글이 직접 만든 표라는 점은 감안해야 하지만, 약한 항목까지 그대로 보여 줬다는 점에서 참고할 만합니다.

| 평가 | 아르곤 | GPT-6 아스트라 | 오퍼스 5.5 | 1위 |
|---|---|---|---|---|
| Vals Index(지식 작업) | 68.9% | 63.1% | 67.0% | 아르곤 |
| AutomationBench(업무 자동화) | 51.3% | 41.4% | 42.5% | 아르곤 |
| DeepSWE v1.1(장기 코딩) | 77.9% | 74.1% | 74.2% | 아르곤 |
| FrontierSWE v2(코딩) | 55.0% | 65.5% | 62.3% | 아스트라 |
| Terminal-bench 4.0(터미널 코딩) | 57.4% | 58.2% | 66.4% | 오퍼스 5.5 |
| OSWorld-2.0(컴퓨터 조작) | 69.2% | 72.6% | - | 아스트라 |
| Terminal-Bench Science 0.1(과학) | 57.6% | 68.1% | 63.3% | 아스트라 |
| LVBench(긴 영상 이해) | 91.7% | 87.5% | 83.7% | 아르곤 |
| CWE-bench v1(취약점 수정) | 68.0% | 68.0% | 67.0% | 공동 1위 |

정리하면 아르곤은 금융·법률 같은 지식 작업, 오래 이어지는 소프트웨어 작업, 긴 영상 이해, 보안 방어에서 강합니다. 반면 터미널 중심 코딩은 오퍼스 5.5가, OSWorld-2.0 오프라인 일부 평가와 Terminal-Bench Science 0.1은 GPT-6 아스트라가 앞섭니다. 같은 컴퓨터 조작·과학 분야라도 Agent’s Last Exam, LABBench 2, RiemannBench에서는 아르곤이 앞서 평가마다 결과가 갈립니다. 이번 주 나온 GPT-6.1 솔은 이 표에 없어서 직접 비교할 수 없습니다.

주의 벤치마크는 각 회사가 고른 조건에서 잰 값이라, 같은 이름이라도 다른 회사 발표와 숫자가 다를 수 있습니다. 실제 업무 체감은 공개 뒤 직접 써 봐야 알 수 있습니다.

구글은 아르곤이 이미 내부 업무에 쓰이고 있다며 구체적인 사례를 들었습니다. 수천 명의 구글 직원이 전문 코딩, 깊은 조사, 글쓰기에서 강점을 꼽았다고 합니다.
| 구글 내부 사례 | 결과(구글 발표) |
|---|---|
| 양자 알고리즘 최적화 | 공개된 기준보다 40% 개선을 몇 분 만에 |
| 데이터센터 메모리 최적화 | 전면 적용되면 300TiB 넘게 확보, 전체 500TiB~1PiB 절감 추정 |
| C/C++ 코드를 러스트로 옮기기 | 핵심 라이브러리부터 80만 줄 넘는 커널까지 이전 작업 중(운영 적용 전 검토·시험) |
| 영상 디코더 libgav1 | 기존 러스트 이식본보다 2.7배 빠르고 결과는 동일 |

출력 한도를 100만 토큰으로 늘린 것도 이런 쓰임새를 위해서입니다. 모델이 한 번에 수십만 토큰을 생각하고 써 내려갈 여유가 생기면 어려운 문제를 한 번에 풀 수 있다는 설명입니다. 다만 입력 컨텍스트 크기는 발표문에 따로 나오지 않았습니다.
구글은 공개 전에 네 가지를 강화하고 있다고 밝혔습니다. 사이버·화생방 악용 방지, 간접 프롬프트 인젝션 방어, 모델의 생각과 행동을 감시하다 필요하면 멈추는 정렬 감시, 고위험 테스트 환경 격리입니다. 같은 주 오픈AI가 안전 문제로 GPT-6.1 아스트라 출시를 취소한 것과 맞물려, 프런티어 모델 공개가 점점 "단계적"으로 바뀌는 흐름이 뚜렷합니다.

제 판단으로는 일반 사용자가 지금 할 일은 많지 않습니다. 제미나이 앱 업데이트를 켜 두고, 업무에 쓰려는 사람은 구글 AI 울트라 요금제 가격과 지금 쓰는 도구의 결과를 비교할 기준 작업 두세 개를 정해 두는 정도면 충분합니다. 공개되면 같은 과제를 GPT, 클로드와 나란히 돌려 보는 것이 가장 정확한 비교입니다.
아닙니다. 구글 발표 기준으로 지금은 페어윈드 프로그램 참가 기관과 신뢰 테스터만 씁니다. 유료 API 고객과 구글 AI 울트라 구독자부터 열린다고 했지만 날짜는 발표되지 않았습니다.
도입 가격 기준 입력 100만 토큰당 2달러, 출력 10달러로 오픈AI가 발표한 GPT-6.1 솔의 표준 가격과 같습니다. 다만 아르곤은 도입 기간이 끝나면 4달러·20달러로 오릅니다.
3줄 핵심 요약
제미나이 4 아르곤은 발표 뒤 이용 대상을 단계적으로 넓히는 구글 플래그십입니다. 성능만큼이나 언제, 누구에게 열리느냐가 중요한 모델이 됐습니다. 오늘은 제미나이 앱이 최신 버전인지 확인하고, 공개되면 비교해 볼 나만의 시험 과제 하나를 메모해 두세요.
#제미나이4,#제미나이,#Gemini4,#아르곤,#구글AI,#구글딥마인드,#AI모델,#GPT6,#클로드,#요즘소식
| 제미나이 무료는 10월 9일부터 Flash-Lite만 | 요금제별로 남는 모델, 노력 수준과 한도, 유료로 갈지 판단법 (0) | 2026.10.06 |
|---|---|
| 구글 오팔(Opal) 11월 17일 종료 | 워크플로 백업법과 제미나이 스킬로 옮기기, 젬(Gem)은 자동 전환 (0) | 2026.10.01 |
| 챗GPT 프로 200, 코덱스 사용량 절반으로 | 프로 500 등장, 내게 맞는 요금제 고르기 (0) | 2026.10.01 |
| 카나나 10월 15일 종료 | 대화 백업은 PC에서 14일까지, 이미지는 한 장씩 (0) | 2026.09.30 |
| 오픈AI 에이전트가 DNS로 차단을 뚫었다 | 무슨 일이었고 챗GPT 사용자와는 무슨 관계인가 (0) | 2026.09.30 |
댓글 영역