상세 컨텐츠

본문 제목

제미나이 4 아르곤 발표, 아직 못 쓰는 이유 | 언제 열리나, GPT·클로드와 성적표 비교

AI 이야기/요즘 소식

by 사이 (SAI) 2026. 10. 1. 12:25

본문

728x90
반응형

구글이 9월 30일(현지 시간) 차세대 모델 "제미나이 4 아르곤(Gemini 4 Argon)"을 발표했습니다. 해커뉴스에서도 크게 화제가 됐지만, 막상 제미나이 앱을 열어 보면 아르곤은 보이지 않습니다.

이유는 간단합니다. 구글이 이번에는 "발표"만 하고 일반 공개는 단계적으로 미뤘기 때문입니다. 지금 누가 쓰고 있는지, 언제 누구부터 열리는지, 공식 성적표에서 GPT-6 아스트라·클로드 오퍼스 5.5보다 어디가 앞서고 어디가 밀리는지를 구글 공식 블로그 원문 기준으로 정리했습니다.

제미나이 4 아르곤은 구글이 2026년 9월 30일 발표한 프런티어 모델로, 지금은 페어윈드(Fairwind) 프로그램의 일부 사이버 보안 방어 기관과 신뢰할 수 있는 테스터만 쓴다. 구글은 안전장치를 다듬은 뒤 유료 API 고객과 구글 AI 울트라 구독자부터 열겠다고 했고, 일반 공개 날짜는 밝히지 않았다. API 도입 가격은 입력 100만 토큰당 2달러, 출력 10달러(도입 기간 뒤 4달러·20달러)이며 출력 한도는 100만 토큰이다. 공식 표에서 지식 작업(Vals Index)·장기 코딩(DeepSWE)·긴 영상 이해는 1위지만, Terminal-bench 4.0은 오퍼스 5.5, OSWorld-2.0 오프라인 일부 평가와 Terminal-Bench Science는 GPT-6 아스트라가 앞선다.

1. 제미나이 4 아르곤, 지금 누가 쓰나

유리벽 연구실 앞 벨벳 줄과 공개 준비 중 팻말, 안쪽에서 보안 엔지니어들이 일하는 장면

구글 공식 블로그의 첫 문단은 이렇게 시작합니다. 제미나이 4 아르곤은 "페어윈드 프로그램을 통해 신뢰할 수 있는 사이버 방어 담당자들에게 배포되고 있다." 즉 지금 아르곤을 쓰는 사람은 보안 방어 기관과 구글이 고른 초기 테스터, 그리고 구글 내부 직원입니다.

구글 공식 블로그의 제미나이 4 아르곤 대표 이미지
출처: 구글 공식 블로그

구글은 이 수준의 능력을 안전하게 내놓으려면 단계적 접근이 필요하다며, 미국 정부의 자발적 사전 모델 접근 절차에도 참여하고 있다고 밝혔습니다. 초기 테스터의 피드백으로 안전장치를 다듬은 뒤 개발자, 기업, 일반 소비자에게 "가능한 한 빨리" 열겠다는 입장입니다.

구글 블로그 발표문 첫머리, 페어윈드 프로그램 배포와 단계적 공개, 입력 2달러 출력 10달러 도입 가격
출처: 구글 공식 블로그 갈무리

핵심 지금 제미나이 앱(무료·유료)이나 AI 스튜디오에서 아르곤을 고를 수 있다는 공식 안내는 없습니다. "제미나이 4를 써 봤다"는 글은 내부 테스트 화면이거나 이전 모델일 가능성이 큽니다.

2. 언제, 누구부터 열리나

제미나이 4 아르곤 공개 순서를 정리한 도식

단계 대상 상태
1단계 페어윈드 프로그램의 사이버 방어 담당자, 신뢰 테스터, 구글 내부 지금 진행 중
2단계 유료 API 고객, 구글 AI 울트라 구독자 "곧" 시작(날짜 미발표)
3단계 더 넓은 개발자·기업·일반 소비자 순차 확대 예정

구글은 공개 순서를 "유료 API 고객과 구글 AI 울트라 구독자부터"라고 적었습니다. 무료 사용자나 중간 요금제가 언제 쓸 수 있는지는 밝히지 않았습니다. 한국어 지원과 한국 계정 제공 시점도 아직 공식 안내가 없습니다.

항목 공식 발표 내용
API 도입 가격 입력 100만 토큰당 2달러, 출력 10달러
캐시 입력 입력 단가에서 95% 할인
도입 기간 뒤 가격 입력 4달러, 출력 20달러(발표문 각주)
출력 한도 100만 토큰(이전 6만 4천 토큰에서 확대)
보안 방어 기관 사이버 가드레일 없이 제공해 방어 능력을 최대한 활용

발표문 각주에 따르면 도입 기간이 끝나면 입력 100만 토큰당 4달러, 출력 20달러로 두 배가 됩니다. 도입 기간이 언제 끝나는지는 밝히지 않았으니, API로 쓸 계획이라면 정가 기준으로도 비용을 계산해 두는 게 좋습니다.

3. 공식 성적표: 어디가 앞서고 어디가 밀리나

구글은 발표문에 GPT-6 아스트라, 클로드 페이블 5.1, 클로드 오퍼스 5.5와 나란히 놓은 벤치마크 표를 실었습니다. 구글이 직접 만든 표라는 점은 감안해야 하지만, 약한 항목까지 그대로 보여 줬다는 점에서 참고할 만합니다.

구글 공식 벤치마크 표, 제미나이 4 아르곤과 GPT-6 아스트라, 클로드 페이블 5.1, 클로드 오퍼스 5.5 비교
출처: 구글 공식 블로그(벤치마크 표)

평가 아르곤 GPT-6 아스트라 오퍼스 5.5 1위
Vals Index(지식 작업) 68.9% 63.1% 67.0% 아르곤
AutomationBench(업무 자동화) 51.3% 41.4% 42.5% 아르곤
DeepSWE v1.1(장기 코딩) 77.9% 74.1% 74.2% 아르곤
FrontierSWE v2(코딩) 55.0% 65.5% 62.3% 아스트라
Terminal-bench 4.0(터미널 코딩) 57.4% 58.2% 66.4% 오퍼스 5.5
OSWorld-2.0(컴퓨터 조작) 69.2% 72.6% - 아스트라
Terminal-Bench Science 0.1(과학) 57.6% 68.1% 63.3% 아스트라
LVBench(긴 영상 이해) 91.7% 87.5% 83.7% 아르곤
CWE-bench v1(취약점 수정) 68.0% 68.0% 67.0% 공동 1위

구글 공식 DeepSWE v1.1 차트, 제미나이 4 아르곤 77.9퍼센트
출처: 구글 공식 블로그(DeepSWE v1.1)

정리하면 아르곤은 금융·법률 같은 지식 작업, 오래 이어지는 소프트웨어 작업, 긴 영상 이해, 보안 방어에서 강합니다. 반면 터미널 중심 코딩은 오퍼스 5.5가, OSWorld-2.0 오프라인 일부 평가와 Terminal-Bench Science 0.1은 GPT-6 아스트라가 앞섭니다. 같은 컴퓨터 조작·과학 분야라도 Agent’s Last Exam, LABBench 2, RiemannBench에서는 아르곤이 앞서 평가마다 결과가 갈립니다. 이번 주 나온 GPT-6.1 솔은 이 표에 없어서 직접 비교할 수 없습니다.

제미나이 4 아르곤의 강점과 약점을 정리한 도식

반응형

주의 벤치마크는 각 회사가 고른 조건에서 잰 값이라, 같은 이름이라도 다른 회사 발표와 숫자가 다를 수 있습니다. 실제 업무 체감은 공개 뒤 직접 써 봐야 알 수 있습니다.

4. 구글 안에서는 이미 이렇게 쓴다

세 갈래로 나뉜 줄이 문으로 이어지고 순차 공개라고 적힌 팻말이 선 일러스트

구글은 아르곤이 이미 내부 업무에 쓰이고 있다며 구체적인 사례를 들었습니다. 수천 명의 구글 직원이 전문 코딩, 깊은 조사, 글쓰기에서 강점을 꼽았다고 합니다.

구글 내부 사례 결과(구글 발표)
양자 알고리즘 최적화 공개된 기준보다 40% 개선을 몇 분 만에
데이터센터 메모리 최적화 전면 적용되면 300TiB 넘게 확보, 전체 500TiB~1PiB 절감 추정
C/C++ 코드를 러스트로 옮기기 핵심 라이브러리부터 80만 줄 넘는 커널까지 이전 작업 중(운영 적용 전 검토·시험)
영상 디코더 libgav1 기존 러스트 이식본보다 2.7배 빠르고 결과는 동일

구글 블로그의 출력 토큰 한도 100만 토큰 확대 설명
출처: 구글 공식 블로그 갈무리

출력 한도를 100만 토큰으로 늘린 것도 이런 쓰임새를 위해서입니다. 모델이 한 번에 수십만 토큰을 생각하고 써 내려갈 여유가 생기면 어려운 문제를 한 번에 풀 수 있다는 설명입니다. 다만 입력 컨텍스트 크기는 발표문에 따로 나오지 않았습니다.

5. 안전장치와 우리가 지금 할 일

구글은 공개 전에 네 가지를 강화하고 있다고 밝혔습니다. 사이버·화생방 악용 방지, 간접 프롬프트 인젝션 방어, 모델의 생각과 행동을 감시하다 필요하면 멈추는 정렬 감시, 고위험 테스트 환경 격리입니다. 같은 주 오픈AI가 안전 문제로 GPT-6.1 아스트라 출시를 취소한 것과 맞물려, 프런티어 모델 공개가 점점 "단계적"으로 바뀌는 흐름이 뚜렷합니다.

구글 블로그 Rolling out soon 단락, 유료 API 고객과 구글 AI 울트라 구독자부터 공개
출처: 구글 공식 블로그 갈무리

제 판단으로는 일반 사용자가 지금 할 일은 많지 않습니다. 제미나이 앱 업데이트를 켜 두고, 업무에 쓰려는 사람은 구글 AI 울트라 요금제 가격과 지금 쓰는 도구의 결과를 비교할 기준 작업 두세 개를 정해 두는 정도면 충분합니다. 공개되면 같은 과제를 GPT, 클로드와 나란히 돌려 보는 것이 가장 정확한 비교입니다.

Q. 지금 제미나이 앱에서 아르곤을 쓸 수 있나요?

아닙니다. 구글 발표 기준으로 지금은 페어윈드 프로그램 참가 기관과 신뢰 테스터만 씁니다. 유료 API 고객과 구글 AI 울트라 구독자부터 열린다고 했지만 날짜는 발표되지 않았습니다.

Q. API 가격은 GPT-6.1 솔과 비교하면 어떤가요?

도입 가격 기준 입력 100만 토큰당 2달러, 출력 10달러로 오픈AI가 발표한 GPT-6.1 솔의 표준 가격과 같습니다. 다만 아르곤은 도입 기간이 끝나면 4달러·20달러로 오릅니다.

3줄 핵심 요약

  1. 제미나이 4 아르곤은 9월 30일 발표됐지만 지금은 보안 방어 기관·테스터만 쓰고, 유료 API·AI 울트라부터 순차 공개된다.
  2. API 도입가는 입력 2달러·출력 10달러(100만 토큰, 도입 기간 뒤 4·20달러), 출력 한도는 100만 토큰이다.
  3. 공식 표에서 지식 작업·장기 코딩·긴 영상은 1위, 터미널 코딩은 오퍼스 5.5, OSWorld-2.0·Terminal-Bench Science는 아스트라가 앞선다.

마치며

제미나이 4 아르곤은 발표 뒤 이용 대상을 단계적으로 넓히는 구글 플래그십입니다. 성능만큼이나 언제, 누구에게 열리느냐가 중요한 모델이 됐습니다. 오늘은 제미나이 앱이 최신 버전인지 확인하고, 공개되면 비교해 볼 나만의 시험 과제 하나를 메모해 두세요.

NEXT READ

이어서 읽어 볼 글

01  GPT-6 아스트라·솔·루나 차이 총정리 · 경쟁 모델 정리

02  클로드 오퍼스 5.5 출시 · 비교 대상 모델

#제미나이4,#제미나이,#Gemini4,#아르곤,#구글AI,#구글딥마인드,#AI모델,#GPT6,#클로드,#요즘소식

728x90
반응형

관련글 더보기

댓글 영역