상세 컨텐츠

본문 제목

클로드 오퍼스 5.5 출시 | 오퍼스 5보다 40% 싸진 이유와 구독자 혜택

AI 이야기/요즘 소식

by 사이 (SAI) 2026. 9. 24. 09:26

본문

클로드 오퍼스 5.5를 한 문장으로 줄이면 "최상위 모델 페이블 5.1 수준의 일을, 오퍼스 5보다 40% 싸게"입니다.

앤트로픽이 9월 22일 공개한 이 모델은 Claude 5.5 제품군의 첫 주자이고, Pro·Max 구독자에게는 5시간 사용 한도 상향이라는 선물도 함께 왔습니다.

가격, 성능, 말투, 안전장치, 구독자 혜택까지 오퍼스 5와 무엇이 달라졌는지 비교해 봤습니다.

Claude Opus 5.5는 앤트로픽이 2026년 9월 22일 출시한 모델로, 대부분의 작업에서 Claude Fable 5.1 수준의 성능을 내면서 일반적인 작업 기준 비용은 Opus 5보다 40% 적다. API 가격은 100만 토큰당 입력 4달러, 출력 20달러다.

클로드 모델 이름부터 정리하면

오퍼스 5.5의 위치를 알려면 클로드 가족 구성을 먼저 봐야 합니다.

앤트로픽은 모델을 크기와 용도에 따라 이름을 붙입니다. 하이쿠가 가장 가볍고, 소네트가 중간, 오퍼스가 고성능 주력, 페이블이 최상위입니다.

모델 역할 API 가격(입력/출력, 100만 토큰)
Claude Fable 5.1 가장 어려운 추론과 긴 에이전트 작업 10달러 / 50달러
Claude Opus 5.5 오래 걸리는 코딩과 전문 업무의 새 주력 4달러 / 20달러
Claude Sonnet 5 속도와 지능의 균형 2달러 / 10달러
Claude Haiku 4.5 가장 빠른 모델 1달러 / 5달러

가격은 앤트로픽 공식 가격 문서 기준입니다.

여기에 보안 검증을 거친 조직 등 제한된 경로로 제공되는 미토스(Mythos) 계열이 따로 있습니다.

소네트 5.5와 하이쿠 5.5도 "몇 주 안에" 나온다고 예고됐습니다. 이번 5.5 세대의 개선이 곧 아래 모델까지 내려온다는 뜻입니다.

오퍼스 5에서 달라진 것, 한 표로

가장 큰 변화는 성능보다 비용입니다.

토큰 단가가 내려갔고, 같은 일을 하는 데 쓰는 토큰 수도 줄었습니다.

항목 Claude Opus 5 Claude Opus 5.5
입력 가격(100만 토큰) 5달러 4달러(20%↓)
출력 가격(100만 토큰) 25달러 20달러(20%↓)
캐시 읽기 0.50달러 0.20달러(60%↓)
캐시 쓰기(5분) 6.25달러 5달러
일반 작업 총비용 기준 약 40%↓
출력 속도 기준 30% 이상 빠름
빠른 모드 입력 10달러 / 출력 50달러 입력 8달러 / 출력 40달러, 최대 2.5배 속도
답변 말투 전문 용어와 긴 설명이 많다는 피드백 핵심을 먼저, 쉬운 말로

캐시 읽기는 한 번 읽힌 긴 문서나 대화를 다시 불러올 때 붙는 요금입니다.

앤트로픽은 이 항목이 에이전트·코딩 작업 비용의 대부분을 차지한다고 설명합니다. 60%나 내려간 게 체감이 큰 이유죠.

단가 20% 인하와 토큰 절약이 겹쳐서 총비용 40% 절감이 나온다는 계산입니다.

오퍼스 5를 쓰고 있었다면 바꾸지 않을 이유가 거의 없다. 더 싸고, 더 빠르고, 앤트로픽이 공개한 모든 평가에서 점수가 높다.

앤트로픽의 Claude Opus 5.5 발표문 도입부, 페이블 5.1 수준 성능과 40% 비용 절감 문장

구독자에게 바로 달라지는 점

API를 쓰지 않는 일반 구독자에게도 이번 발표에는 실질적인 변화가 있습니다.

  • Pro, Max, Team, 좌석형 Enterprise 요금제의 5시간 사용 한도가 올라갔다.
  • 구독자에게 사용량 리셋 1회가 주어지고, 저장해 뒀다가 원하는 때 쓸 수 있다.
  • 오퍼스 5.5는 클로드 앱과 API, AWS·구글 클라우드·마이크로소프트 애저 등 모든 플랫폼에 한 번에 출시됐다.

사용량 리셋은 한도가 바닥난 순간 바로 쓰는 것보다, 마감이 몰린 날까지 아껴 두는 편이 훨씬 쓸모 있습니다.

개인적으로는 이번 발표에서 일반 사용자에게 가장 반가운 대목이 벤치마크가 아니라 이 한 줄이라고 봅니다.

성능은 어디서 앞서고 어디서 밀리나

앤트로픽은 오퍼스 5.5가 에이전트 코딩, 컴퓨터 조작, 지식 노동에서 앞선다고 밝혔습니다.

발표문 표에서 주요 항목만 골랐습니다. 모든 항목에서 이기는 건 아닙니다.

평가 Opus 5.5 Fable 5.1 Opus 5 GPT-6 Astra
Terminal-Bench 4.0(터미널 코딩) 66.4% 55.8% 52.3% 57.9%
GDPval-AA v2.1(44개 직업 실무, Elo) 1846 1735 1708 1542
AutomationBench(업무 자동화) 40.0% 31.4% 26.9% 41.4%
Terminal-Bench-Science(과학 연구) 58.7% 52.6% 29.0% 64.6%
OSWorld 2.0(컴퓨터 조작, 부분 점수) 81.8% 80.7% 74.0% 발표 없음

전승은 아니다.

코딩과 전문 업무는 오퍼스 5.5가, 업무 자동화와 과학 연구 과제는 GPT-6 아스트라가 앞섭니다.

저는 이 표를 보고 나서 각주를 먼저 읽었습니다. 두 가지가 눈에 띄었습니다.

첫째, 앤트로픽 스스로 "이 수준에서는 벤치마크 격차가 실제 차이를 알려 주는 믿을 만한 지표가 못 된다"고 적었습니다. 자사 사용 경험상 페이블 5.1과의 격차도 표보다 좁다고요.

둘째, 평가는 실제 안전장치를 켠 상태로 진행됐습니다. 안전장치가 개입한 사이버 보안 과제는 오퍼스 4.8이 대신 풀었고, 그만큼 점수가 깎였을 수 있다고 밝혔습니다.

이 정도 역량 수준에서는 벤치마크 격차가 실제 차이를 판단하는 기준으로서 덜 믿을 만해졌다. (앤트로픽 발표문)

앤트로픽 발표문의 오퍼스 5.5 벤치마크 비교 표

반응형

실제 작업 사례에서 보인 차이

숫자보다 와닿는 건 발표문에 실린 작업 사례입니다.

  • 20만 줄짜리 코드베이스 점검·수정: 오퍼스 5.5는 3시간 이내, 오퍼스 5는 20시간 넘게 걸리고 토큰을 2.5배 사용
  • HAProxy를 C에서 러스트로 옮기는 작업: 오퍼스 5.5는 9.5시간, 페이블 5.1은 12시간이 걸렸고 비용은 51% 적었음
  • 찾기 어려운 실적 자료로 기업 보고서 쓰기: 오퍼스 5.5는 18번 중 16번 품질 기준 통과, 페이블 5.1과 오퍼스 5는 한 번도 통과 못 함

세 번째 사례의 품질 기준은 "지어낸 숫자나 인용이 하나라도 있으면 탈락"이었습니다. 보고서 작업에 AI를 쓰는 분이라면 가장 눈여겨볼 대목입니다.

말투가 바뀐 게 왜 중요한가

오퍼스 5에 대한 가장 흔한 불만은 글이었습니다. 길고, 용어가 많고, 결론이 늦게 나온다는 것이죠.

오퍼스 5.5는 가장 중요한 정보를 맨 앞에 두고, 전문 용어와 특이한 표현을 덜 쓰고, 사용자가 준 글쓰기 규칙을 더 잘 따르도록 바뀌었습니다.

발표문에는 같은 청구서 버그를 설명한 두 모델의 답이 나란히 실렸습니다.

오퍼스 5는 코드 설명부터 시작합니다. 오퍼스 5.5는 첫 줄에 "무료 요금제 변경 몫은 1.50달러뿐이고, 나머지 9.92달러는 리팩터링 버그 때문"이라고 결론부터 말합니다.

초기 테스터 한 명은 이렇게 평했습니다. "내가 쓰는 방식대로 쓴다."

앤트로픽은 이 변화를 안전 이점으로도 설명합니다. 결과를 따라가고 검토하기 쉬워야 사람이 AI의 실수를 잡을 수 있기 때문입니다.

안전장치, 편해진 만큼 조여진 부분

성능이 오른 만큼 제한도 늘었습니다.

일반 사용자가 알아 둘 것만 추렸습니다.

  • 정렬 평가 최고점: 약 2,000개 시나리오를 도는 자동 행동 감사에서 지금까지 시험한 모델 중 가장 좋은 점수. 정해진 경계를 넘으려는 시도는 오퍼스 5보다 약 85% 줄었다.
  • 사이버 보안 작업 우회: 자기 코드 버그를 찾고 고치는 일은 되지만, 대부분의 사이버 보안 과제는 오퍼스 4.8로 넘어간다. 검증된 보안 전문가용 프로그램은 몇 주 안에 확대 예정이다.
  • 생물학 안전장치: 페이블 5.1과 같은 수준. 연구 기관은 별도 검증 프로그램에 신청해야 한다.
  • 생각 모드 끄기 불가: 오퍼스 5.5는 생각(thinking)을 끈 상태로 쓸 수 없다.
  • 워터마크: EU AI 법 대응을 위한 텍스트 워터마크가 적용된다.

앤트로픽이 한계도 숨기지 않은 점은 눈여겨볼 만합니다. 오퍼스 5.5가 자신이 평가받고 있다고 의심하는 경우가 잦아서, 실제 환경에서의 행동을 완전히 검증하기는 어렵다고 적었습니다.

개발자를 위한 사양 정리

API로 붙여 쓸 분들을 위한 핵심 사양입니다. 앤트로픽 개발자 문서 기준입니다.

항목 값
API 모델 이름 claude-opus-5-5
컨텍스트 창 100만 토큰
최대 출력 12만 8천 토큰(배치 API 베타에서 30만 토큰)
기본 추론 강도(effort) medium
지식 기준 시점 2026년 6월
배치 처리 가격 입력 2달러 / 출력 10달러(50% 할인)
# 모델 이름만 바꾸면 되는 경우가 대부분이지만,
# thinking 비활성화 옵션을 쓰던 코드는 손봐야 한다.
model = "claude-opus-5-5"

주의할 점이 하나 있습니다. 8월 31일 이후 만든 API 계정에는 이전 대화 속 추론 내용을 수정하지 못하게 막는 "preserved thinking"이 적용됩니다.

모델 능력을 대량으로 베껴 가는 증류 공격을 막는 장치인데, 대화 기록을 가공해 다시 보내는 방식의 서비스라면 연동을 점검해야 합니다.

앤트로픽 가격 문서에서 오퍼스 5.5와 다른 클로드 모델 요금이 나란히 보이는 표

자주 묻는 질문

Q. 클로드 오퍼스 5.5는 무료로 쓸 수 있나요?

A. 앤트로픽 가격 페이지 기준으로 무료 요금제는 고를 수 있는 모델이 제한되고, 더 많은 모델은 Pro 요금제부터 제공됩니다. 무료 계정에서 오퍼스 5.5를 쓸 수 있는지는 발표문에 따로 나오지 않았습니다.

Q. 오퍼스 5.5와 페이블 5.1 중 무엇을 써야 하나요?

A. 대부분의 작업은 오퍼스 5.5로 충분합니다. 앤트로픽도 두 모델의 실제 격차가 벤치마크보다 좁다고 밝혔고, API 가격은 오퍼스 5.5가 페이블 5.1의 40% 수준입니다.

Q. 소네트 5.5는 언제 나오나요?

A. 앤트로픽은 소네트 5.5와 하이쿠 5.5가 몇 주 안에 나온다고만 밝혔습니다. 구체적인 날짜는 공개되지 않았습니다.

이런 사람은 지금 바꾸고, 이런 사람은 기다려도 된다

오퍼스 5나 페이블 5.1로 긴 코딩·보고서 작업을 돌리던 분이라면 지금 바로 오퍼스 5.5로 바꾸는 쪽이 맞다고 봅니다. 같은 일을 더 싸고 빠르게, 더 읽기 쉬운 답으로 받습니다.

반대로 가벼운 대화와 요약이 대부분이라면 서두를 필요가 없습니다. 몇 주 뒤 나올 소네트 5.5가 그 용도에는 더 알맞은 선택이 될 가능성이 큽니다.

728x90

관련글 더보기

댓글 영역