조사 기준 2026.09.29 · 출시 초기 평가 · 나래

SONNET 5.5 × OPUS 5.5

소넷과 오퍼스,
어떤 작업에 쓰면 이득일까?

판단·통합이 많은 작업은 Opus 5.5부터, 범위와 검사 기준이 명확한 작업은 Sonnet 5.5도 비교하자. 소넷의 추론량과 재작업이 커지면, 낮은 추론 강도의 Opus가 더 경제적일 수 있다.

사용자의 가설에 대한 판단

“일반 작업은 오퍼스”는 기획·판단·통합이 섞인 주력 세션에서 타당한 출발점이다. 정형 문서와 반복 변환까지 모두 오퍼스로 고정할 필요는 없다.

먼저 비교할 조합

Opus medium + Sonnet medium 작업자를 기준으로 시작하고, 같은 분담 작업을 Opus low에도 배정해 비교한다. 소넷 max의 저렴함은 가정하지 않는다.

effort(모델의 추론 강도)는 low(낮음), medium(중간), high(높음), xhigh(매우 높음), max(최대) 순이다. 위 내용은 자료를 바탕으로 한 운영 제안이다. ‘오퍼스의 낮은 버전’은 low effort로 해석했다. 구형 모델을 뜻한 경우는 아래 별도로 다룬다. 실제 API 비교 실험은 수행하지 않았다.

공식 단가
½ 입력·출력 가격

동일 토큰량이면 소넷이 유리하다. 캐시 읽기(이전에 보낸 입력을 재사용)는 두 모델 모두 100만 토큰당 $0.20으로 같다. [3]

외부 평가 · 두 모델 모두 최대 추론 설정

단가는 싸도, 많이 쓰면 더 비싸다

AA 지능 지수 평가에서 과제당 평균 비용
소넷 5.5: $7.60
오퍼스 5.5: $5.98

평가 기관 Artificial Analysis(AA)의 시험에서 소넷은 토큰 단가가 더 낮아도 토큰을 많이 사용해, 평가 과제당 비용이 오퍼스보다 약 27% 높았다. [7–8]

두 모델 모두 추론 강도를 최대로 설정한 평가 결과이며, 일반 업무의 예상 견적이 아니다. low·medium에서도 소넷이 더 비싸다는 뜻은 아니다. 출시 전 평가 환경의 한계는 아래 설명을 참고한다.

운영 제안
3개 비교 후보

Sonnet low, Sonnet medium, Opus low. 동일한 통과 기준으로 비용과 완료 시간을 비교한다.

01

기본 사양과 시작 설정

Anthropic 공식 문서 기준. 가격은 USD / 100만 토큰, 일반 API 요금. 토큰은 모델이 처리하는 텍스트 등의 단위이며, K는 천, M은 백만을 뜻한다. [1–4]
항목Sonnet 5.5Opus 5.5
출시2026.09.282026.09.22
API 모델 IDclaude-sonnet-5-5claude-opus-5-5
입력 / 출력$2 / $10$4 / $20
캐시 쓰기 · 5분 / 1시간$2.50 / $4$5 / $8
캐시 읽기$0.20$0.20
컨텍스트 / 최대 출력1M / 128K 토큰1M / 128K 토큰
입출력 형태 · 지식 기준텍스트·이미지 입력 / 텍스트 출력 · 2026.06텍스트·이미지 입력 / 텍스트 출력 · 2026.06
API 기본 efforthighmedium
추론Adaptive · 선행 추론 억제 설정 지원Adaptive · 항상 활성

소넷 작업자는 medium부터

Sonnet의 Claude 앱·Code 기본값은 medium이다. API는 high이므로, 앱과 API를 비교할 때는 추론 강도를 맞춰야 한다. 같은 설정이어도 작업 환경에 따라 속도와 비용은 달라진다. [1]

범위가 정해진 분담 작업은 medium에서 시작하고, 간단한 반복 작업은 low도 비교한다. 설정을 낮춘 뒤에도 결과 검사와 완료 조건은 유지한다.

낮은 effort는 할인 모델이 아니다

low는 같은 모델의 토큰 소비 성향을 조정한다. Opus low도 단가는 $4 / $20이다. 생각과 호출이 줄어들어 총비용이 낮아질 수 있을 뿐, 절감률은 고정되지 않는다. [5]

작업자에게 줄 최소 계약

  • 변경 범위와 산출물 형식을 명시한다.
  • 완료 전에 실행할 검사와 종료 조건을 정한다.
  • 임의의 추가 작업자 생성과 범위 확장을 제한한다.
  • 검사 실패·근거 부족은 주력 모델에 반환한다.

공식 가이드는 low의 검증 생략, 높은 effort의 추가 리뷰·범위 확장을 설명한다. 위 계약은 이를 반영한 제안이다. [6]

기존 API 연동이 있다면

추론을 끄던 설정과 캐시 재사용 조건은 버전 전환 시 확인이 필요하다. 비용 비교에서는 추론 강도를 고정하고 실제 캐시 사용량을 기록한다. 구현 세부사항은 공식 이행 가이드 [11]와 설정 가이드 [6]를 참고한다.

02

싸고 빠르다는 말의 기준을 분리한다

독립 측정 / AA

생성 속도는 소넷이 빠르다

Sonnet max
141.9 t/s
Opus max
95.2 t/s

AA의 최대 추론 설정에서 약 1.49배다. 제한된 요청을 다른 모델로 전환하는 기본 대체 처리도 켜진 평가다. 출력 토큰을 생성하는 속도이며, 첫 응답 대기·도구 실행·재시도를 포함한 완료 시간은 아니다. [7–8]

독립 측정 / AA

AA 평가 과제당 비용은 오퍼스가 낮다

Sonnet max
$7.60
Opus max
$5.98

AA 지능 지수(종합 평가 점수)는 소넷 56, 오퍼스 58이다. 소넷이 더 많은 토큰을 쓰는 max 평가에서 비용이 역전됐다. 이 결과로 Opus low가 Sonnet medium보다 항상 낫다고 결론낼 수는 없다. [7–8]

평가의 한계: AA는 9월 28일 발표에서 Sonnet의 출시 전 평가 환경에 정해진 형식의 응답(구조화 출력)을 저하시킬 수 있는 결함이 있었다고 밝혔다. 공개 출시에서는 수정됐으며, AA는 관련 평가를 다시 진행할 예정이라고 안내했다. 위 수치는 9월 29일 확인한 기록으로, 재평가에 따라 달라질 수 있다. [13]

공식 “30%+ 빠름”의 비교 대상은 Sonnet 5다. Opus 5.5 대비 개선율이 아니다. Anthropic 역시 소넷의 낮은 effort에서 비용 이점이 크고, 높은 설정에서는 오퍼스와 작업비가 비슷해질 수 있다고 설명한다. [1]

실제 코드 리뷰에 가까운 참고 자료 · CodeRabbit 자체 평가 [9]
평가Sonnet 5.5비교 대상읽어야 할 의미
어려운 13개 사례의 이슈 탐지6 / 13 · thinking onOpus 5.5 Standard 8 / 13
Opus Max 10 / 13
어려운 리뷰에는 상위 모델의 가치가 남는다.
44개 PR의 평균 리뷰 시간6분 33초Sonnet 5: 13분 31초약 52% 단축. 오퍼스와의 직접 속도 비교는 아니다.

13개 세트는 표본이 작고 Opus 수치는 이전 평가에서 가져왔다. 44개 PR 세트는 당시 품질 판정이 미완료였다. 제품 제공사의 직접 측정이라는 가치와 이해관계를 함께 고려한다.

속도의 실무 기준: “토큰/초”보다 검증을 통과한 결과가 돌아오는 p50·p95(각각 절반·95%의 작업이 끝나는 시간)을 보자. 병렬 처리에서는 가장 늦은 작업자, API 동시성 제한, 도구 대기와 최종 통합이 전체 시간을 결정한다. 작업자 수를 늘리는 것만으로 정비례 가속되지는 않는다.

03

사용자 반응: 기대와 역할 분리가 함께 보인다

9월 29일 확인한 공개 Reddit 스레드 2개와 CodeRabbit 평가를 선별했다. 출시 직후의 정성적 사례이며 대표 표본이나 긍정·부정 비율 조사는 아니다. 아래는 원문을 요약한 내용이다.

접근성에 대한 기대

무료 사용자의 체감 가치는 크다

DynaBeast는 무료 사용자에게 제공되는 성능 향상에 주목했다. 반면 댓글에는 무료 이용 한도와 벤치마크의 실사용 대표성에 대한 의문도 있었다.

r/Anthropic · 9월 29일 확인 · 원문 [10]

어려운 작업은 오퍼스

작업 난도에 따라 평가가 갈린다

JonNordland는 자신의 코딩·에이전트 실험에서 단순·중간 작업은 Opus에 가깝지만, 어려운 작업에서는 차이가 뚜렷하다고 보고했다.

동일 스레드 댓글 · 조건·로그 미공개 개인 경험 · 원문 [10]

운영 구성에 대한 의견

주력 Opus + Sonnet 작업자

Kalcinator는 Opus medium을 주력으로 두고 Sonnet medium 에이전트를 쓰는 구성을 공유했다. Opus low에 대한 언급은 있었지만 직접 비용 비교 결과는 없었다.

r/ClaudeAI · 9월 29일 확인 · 원문 [12]

해당 설정 공유 글의 작성자는 자체 실험을 하지 않았다고 명시했다. 공식 출시문에 실린 파트너 호평은 선별된 추천사이므로, 이 페이지의 일반 사용자 반응과 합산하지 않았다.

04

어떤 일에 배정할 것인가

작업 상황첫 선택 · 제안이유 / 전환 조건
기획, 설계, 요구사항 협의,
여러 결과의 충돌 해결
Opus medium문제 정의와 지속적인 판단을 주력 세션에 유지. high는 품질 개선을 확인한 난제에 한정.
자료별 요약, 표준 문구 변환,
독립 파일의 정형 수정
Sonnet low → medium범위가 작고 검사 기준이 명확할수록 절감 가능. 단순 검사는 코드로 자동화.
작은 버그 수정, 문서·슬라이드 초안,
정해진 설계의 기능 구현
Sonnet medium반복 피드백의 대기 시간을 줄일 후보. 실패가 반복되거나 범위 판단이 필요하면 Opus에 반환.
대규모 맥락을 반복 참조하는
짧은 판단·검토
Opus low와 직접 비교캐시 읽기 단가가 같아 가격 차이가 축소. 오퍼스가 출력·재시도를 줄이면 비용 역전 가능.
숨은 결함, 복잡한 원인 분석,
수정 간 상호작용이 큰 코드
Opus medium / high검토 누락과 통합 실패의 비용이 큼. 소넷 max를 기본 해결책으로 두지 않는다.
시간 제약이 적은 대량 문서 처리Sonnet Batch 검토비동기 API는 일반 입출력 50% 할인. Opus Batch도 함께 비교하며 실시간 작업자 호출과 구분. [3]

권장 분업: 판단은 한곳에, 실행은 검증 가능한 단위로

1 / DEFINEOpus가 범위를 정한다공통 설계·입출력 형식·통과 기준을 고정한다.
2 / EXECUTESonnet이 독립 실행한다필요한 자료만 전달하고, 파일 소유 범위를 분리한다.
3 / CHECK자동 검사 후 선별한다형식·빌드·근거를 검사하고 실패 건을 모은다.
4 / RESOLVEOpus가 예외를 해결한다충돌·판단·최종 통합을 담당한다.
가정 시나리오 A

독립 작업 100건: 분업이 유리한 경우

건당 신규 입력 10K, 출력 2K라면 소넷 $0.04, 오퍼스 $0.08. 소넷 100건은 $4, 오퍼스 100건은 $8이다.

소넷 결과의 10%를 같은 토큰량의 오퍼스로 한 번 재처리하면 $0.80, 별도 계획·통합비를 $1로 가정하면 혼합 구성 $5.80. 오퍼스만 $8인 기준보다 $2.20 절감한다.

모든 결과가 최종 통과한다는 가정. 도구비·사람 검토비 제외. 기준 오퍼스 구성은 별도 조율비 0으로 두었다.

가정 시나리오 B

캐시 중심: Opus low가 역전하는 경우

건당 캐시 읽기 200K + 신규 입력 5K. 소넷 출력 4K, 오퍼스 low 출력 1.5K를 가정하면 각각 $0.09 / $0.09로 같다.

소넷은 $0.04 + $0.01 + $0.04, 오퍼스는 $0.04 + $0.02 + $0.03이다. 여기서 오퍼스 출력이 더 줄거나 소넷에 재작업이 붙으면 오퍼스가 저렴해진다.

low가 실제로 1.5K를 쓴다는 측정 결과가 아니다. 같은 품질에서 출력량이 달라질 때의 손익분기 예시다. 캐시 초기 생성비 제외.

가정 시나리오 C — 소넷 재작업 증가

A와 같은 작업에서 Opus 재처리 비율이 10%에서 50%로 늘면, 소넷 $4 + 재처리 $4 + 조율 $1 = $9이다. Opus 전용 처리 $8보다 $1 비싸다. 아래 계산기의 C 버튼으로 같은 가정을 확인할 수 있다.

추가 사례: 인간 검토비가 절감을 지우는 경우. 위 A에서 API 절감액은 100건에 $2.20이다. 추가 인간 검토가 총 5분이고 시간을 $30/시간으로 평가하면 $2.50이 추가되어 절감이 사라진다. 계산기는 인간 검토비를 포함하지 않으므로 이 비용은 별도로 더해야 한다. 작업자 선택은 검토까지 마친 결과의 총비용으로 판단한다. 예시 가정

‘낮은 버전’이 Opus 5 또는 4.x를 뜻했다면?

공식 표에서 Opus 5·4.8의 일반 입력/출력은 $5 / $25, 캐시 읽기는 $0.50이다. Opus 5.5의 $4 / $20, $0.20보다 비싸다. 따라서 구형 Opus를 고르는 것이 단가 절감책은 아니다. 특정 구형 모델에서만 검증된 동작이나 계약 요금이 있다면 별도 비교해야 한다. [3]

Claude 구독으로만 쓰는 경우에도 API 가격을 적용할 수 있나?

이 페이지의 달러 계산은 토큰 종량제 API 기준이다. 정액 구독에서 사용자의 경제적 이득은 추가 지출보다 사용 한도, 대기 시간, 수정 횟수로 평가해야 한다. API 단가가 절반이라고 구독 사용량이나 월요금도 절반이라고 해석하지 않는다.

05

우리 작업량으로 비용을 바꿔 본다

입력값은 한 작업의 전체 API 호출 합계다. 출력에는 과금되는 추론 토큰을 포함한다. 아래 기본값은 실측이 아닌 시나리오이며, 모델별 품질이 동등하다는 보장도 아니다.

Sonnet 5.5 · 작업당 토큰
Opus 5.5 · 작업당 토큰 / 재처리 1건에도 동일 적용
Sonnet 선처리 + Opus 재처리$5.80소넷 $4.00 + 재처리 $0.80 + 조율 $1.00
Opus 전용 처리$8.00오퍼스 $8.00 + 조율 $0.00

혼합 구성이 $2.20 (27.5%) 저렴합니다.

현재 가정에서 재처리 비율 37.5% 미만이면 혼합 구성이 저렴합니다.

계산식과 제외 항목

S = (2×신규입력 + 0.2×캐시읽기 + 2.5×캐시쓰기 + 10×출력) / 1,000,000
O = (4×신규입력 + 0.2×캐시읽기 + 5×캐시쓰기 + 20×출력) / 1,000,000
혼합 = N×S + N×재처리비율×O + 혼합 조율비
Opus 전용 = N×O + Opus 조율비

입력 3종은 중복 없이 분리한다. 캐시 쓰기는 5분 요금만 적용. 재처리 비율은 기대값이며 최대 한 번의 Opus 재처리를 가정한다. 도구·검색 요금, 세금, 사람의 검토 시간, 재처리 실패, 추가 재시도, Batch·Fast·지역 요금은 제외한다. 모델 전환 시 캐시 공유를 가정하지 않으며, 해당 모델에서 실제 발생하는 토큰을 각각 입력해야 한다.

06

도입 판단은 작은 동일 조건 실험으로

실제 업무 30건을 정형·중간·복잡 작업으로 나누고, Sonnet low / Sonnet medium / Opus low / Opus medium을 같은 입력과 도구 조건에서 비교한다. 아래는 실험 제안이며 이미 수행한 결과가 아니다.

비용

입력·캐시·출력 토큰, 재시도, 도구비, 조율비를 합산한다. 총지출 ÷ 최종 통과 건수를 기록한다.

속도

첫 응답보다 검증 완료까지의 p50·p95를 본다. 동일 동시성에서 대기와 재처리를 포함한다.

품질

모델명을 가리고 판정한다. 첫 시도 통과율, 누락, 범위 밖 수정과 인간 수정 시간을 기록한다.

권장 채택 조건: 품질 기준을 유지하면서 총비용이나 완료 시간을 개선한 작업군만 소넷으로 옮긴다. Opus low가 우세한 작업군은 오퍼스에 남긴다. 이 기준이라면 “소넷은 대량 서브에이전트용”이라는 가설을 실제 운영 규칙으로 검증할 수 있다.

REF

출처와 읽는 범위

2026.09.29 열람. 공식 문서 = 사양·요금, 외부 평가 = 해당 조건의 측정, 커뮤니티 = 개인 반응. 링크 내용과 가격은 이후 변경될 수 있다.

  1. Sonnet 5.5 공식 발표2026.09.28 · 출시, 앱 설정, 전작 대비 속도·effort 해석
  2. Opus 5.5 공식 발표2026.09.22 · 출시·모델 포지셔닝
  3. Anthropic API 가격표일반·캐시·Batch·구형 모델 요금
  4. 공식 모델 비교표모델 ID, 컨텍스트·출력 상한, 기본 effort
  5. Effort 공식 문서추론 수준의 동작과 API 지정 방식
  6. Sonnet 5.5 프롬프팅 가이드medium 시작, 검증 생략, 과도한 추가 작업, 캐시 영향
  7. Artificial Analysis · Sonnet 5.5max / default fallback · 속도, 지수, 작업당 비용
  8. Artificial Analysis · Opus 5.5max / default fallback · 동일 지표 비교
  9. CodeRabbit · Sonnet 5.5 평가2026.09.28 · 직접 코드 리뷰 평가, 작은 표본과 비교 조건 주의
  10. Reddit · 무료 모델 평가 스레드9월 29일 확인 · 기대와 고난도 성능에 대한 반론
  11. Sonnet 5.5 이행 가이드thinking 설정 변경 등 API 이행 정보
  12. Reddit · 설정 가이드와 운영 구성 댓글9월 29일 확인 · 직접 실험과 문서 재해석을 구별
  13. Artificial Analysis · Sonnet 5.5 발표 분석2026.09.28 · 출시 전 평가 환경의 결함과 재평가 예정 안내