Claude Opus 5.5 가격과 성능 비교 정리
Claude Opus 5.5는 표준 입력·출력 토큰 단가를 Opus 5보다 20% 낮췄습니다. 작업 비용 40% 절감은 Anthropic의 평가 결과이며, 실제 비용은 토큰 사용량과 캐시 활용에 따라 달라집니다.
- Claude Opus 5.5의 표준 요금은 100만 토큰당 입력 4달러, 출력 20달러입니다.
- 캐시 읽기 단가는 100만 토큰당 0.20달러로 Opus 5보다 60% 낮습니다.
- Terminal-Bench 4.0 점수는 Anthropic 발표 기준 52.3%에서 66.4%로 올랐습니다.
- 경계 우회 시도 약 85% 감소는 특정 안전성 평가에서 나온 결과입니다.
- 기존 API를 전환하려면 모델명과 함께 추론·도구 호출 설정을 점검하세요.
Claude Opus 5.5는 표준 토큰 단가를 20% 낮춘 모델입니다. 코딩과 컴퓨터 사용 평가 점수도 높아졌습니다. 작업 비용 40% 절감은 Anthropic의 시험 결과입니다.
가격과 평가 수치는 Anthropic의 2026년 9월 22일 발표 기준입니다.
Claude Opus 5.5 가격 비교
표준 API 요금은 100만 토큰당 입력 4달러, 출력 20달러입니다. 토큰은 모델이 글 등을 처리하는 단위입니다. 입력은 모델에 보내는 내용을, 출력은 모델이 생성하는 내용을 뜻합니다.
| 과금 항목 | Opus 5 | Opus 5.5 | 단가 인하율 |
|---|---|---|---|
| 일반 입력 100만 토큰 | 5달러 | 4달러 | 20% |
| 출력 100만 토큰 | 25달러 | 20달러 | 20% |
| 캐시 읽기 100만 토큰 | 0.50달러 | 0.20달러 | 60% |
금액은 미국 달러 기준입니다. 캐시는 반복해서 쓰는 입력을 저장해 재사용하는 기능입니다. 캐시를 만드는 비용은 읽기 비용과 별도로 계산합니다.
작업 비용 40% 절감의 조건
40%는 모든 요청에 적용되는 할인율이 아닙니다. Anthropic이 기본 설정의 일반적인 작업에서 산출한 절감치입니다. 낮아진 단가와 작업당 토큰 사용량 감소를 함께 반영합니다.
| 사용 조건 | 비용을 좌우하는 항목 | 확인할 내용 |
|---|---|---|
| 매번 새로운 내용을 입력 | 일반 입력·출력 사용량 | 두 항목의 실제 토큰 수 |
| 같은 문서나 지시를 반복 사용 | 캐시 생성·읽기 사용량 | 캐시가 실제로 재사용됐는지 |
| 여러 단계를 수행하는 코딩 에이전트 | 반복 호출과 재시도 | 작업 완료까지 쓴 전체 비용 |
| 월정액 구독 | 구독 요금과 사용 한도 | 토큰 단가와 구독료의 구분 |
API 단가 인하만으로 월정액 구독료 인하를 뜻하지는 않습니다. 자체 서비스의 절감률을 보려면 같은 작업의 사용량을 비교하세요. Anthropic의 Opus 안내에서도 40%는 토큰 과금 작업의 추정치로 설명합니다.
계산 예시
입력과 출력을 각각 100만 토큰 사용하면 표준 비용은 24달러입니다. 비교를 위해 두 모델의 사용량이 같다고 가정합니다. 캐시와 별도 도구 비용은 제외한 계산입니다.
| 계산 항목 | Opus 5 | Opus 5.5 |
|---|---|---|
| 일반 입력 100만 토큰 | 5달러 | 4달러 |
| 출력 100만 토큰 | 25달러 | 20달러 |
| 합계 | 30달러 | 24달러 |
차액은 6달러이며 절감률은 20%입니다. 이 계산에는 작업당 토큰 감소 효과가 없습니다. 따라서 단가만 적용한 결과는 발표의 40%와 다릅니다.
캐시 읽기 100만 토큰의 차액은 0.30달러입니다. 다만 이 금액은 읽기 항목만 비교한 결과입니다. 전체 청구액에는 캐시 생성과 다른 토큰 비용도 반영해야 합니다.
에이전트 코딩과 컴퓨터 사용 성능
Anthropic의 발표에서는 코딩과 컴퓨터 사용 점수가 모두 높아졌습니다. 에이전트 코딩은 도구를 사용하며 여러 단계의 개발 작업을 수행하는 방식입니다. 컴퓨터 사용은 화면을 보고 인터페이스를 조작하는 능력입니다.
| 평가 | Opus 5 | Opus 5.5 | 점수 차이 |
|---|---|---|---|
| Terminal-Bench 4.0 | 52.3% | 66.4% | 14.1%포인트 |
| CursorBench 4.0 | 46.6% | 57.8% | 11.2%포인트 |
| OSWorld 2.1 | 74.0% | 81.8% | 7.8%포인트 |
공식 발표에 적힌 평가명은 OSWorld 2.1입니다. 해당 점수에는 partial 표시가 붙어 있습니다. 버전과 채점 표시를 함께 남겨야 다른 결과와 혼동하지 않습니다.
Terminal-Bench 4.0의 Opus 5.5 결과는 xhigh 설정입니다. 발표의 기본 설정 비용 추정치와 평가 조건이 같지는 않습니다. 점수 상승만으로 실제 프로젝트의 성공률을 계산할 수는 없습니다.
속도와 글쓰기 변화
Anthropic은 출력 생성 속도가 Opus 5보다 30% 넘게 빨라졌다고 발표했습니다. 이는 글이 생성되는 속도에 관한 수치입니다. 검색과 테스트를 포함한 전체 작업 시간의 감소율은 별도로 측정해야 합니다.
글쓰기는 핵심을 앞에 두고 읽기 쉽게 설명하도록 개선했다고 합니다. 다만 한국어 문서의 품질 향상률은 별도로 제시되지 않았습니다. 팀에서 쓰는 문서로 다음 항목을 확인하세요.
- 결론과 근거가 구분되는지
- 요청한 문체와 형식을 지키는지
- 수치와 인용을 원문에서 확인할 수 있는지
- 코드 변경 이유를 검토할 수 있게 설명하는지
안전성 평가 85% 감소의 의미
약 85% 감소는 격리 경계를 우회하려는 시도의 감소율입니다. 비교 대상은 Opus 5 또는 Claude Mythos 5.1입니다. 실제 서비스의 사고율이 같은 비율로 줄었다는 뜻은 아닙니다.
샌드박스는 프로그램의 접근 범위를 제한하는 실행 환경입니다. 모델의 안전성 평가와 이 환경의 접근 제한은 별개입니다. 평가 점수가 좋아져도 운영 권한을 자동으로 넓힐 근거는 없습니다.
Anthropic은 배포 전 모든 실패를 발견하는 평가가 아직 어렵다고 설명합니다. 수치의 범위는 Claude Opus 5.5 발표의 안전성 항목에서 확인할 수 있습니다. 운영 시에는 파일 접근 범위와 실행 기록을 함께 점검하세요.
API 전환에서 확인할 설정
기존 API 연동은 모델명 외의 설정도 확인해야 합니다. Claude API 모델 식별자는 claude-opus-5-5입니다. 다른 클라우드는 각 플랫폼의 모델 식별자를 사용합니다.
공식 전환 문서는 추론 설정의 변경을 다음과 같이 명시합니다.
Thinking can't be disabled
출처는 Anthropic의 Migrating to Claude Opus 5.5입니다. 이는 추론을 끄는 설정을 지원하지 않는다는 뜻입니다.
- 기존 요청에서 추론을 끄는 설정을 확인하세요. Opus 5.5는 해당 설정을 거부합니다.
- 추론 강도인
effort를 명시하세요. Opus 5.5의 기본값은medium입니다. - 특정 도구 호출을 강제하는 설정을 점검하세요. 지원하지 않는 설정은 요청 오류를 일으킵니다.
- 응답은 블록의
type으로 구분해 처리하세요. 첫 블록이 항상 답변 텍스트인 것은 아닙니다. - 같은 작업으로 비용과 완료 시간을 다시 측정하세요. 추론 토큰도 출력 요금에 포함됩니다.
공개 당시 AWS, Google Cloud, Microsoft Azure 지원도 발표됐습니다. 플랫폼마다 모델 식별자와 도구 지원 조건은 다를 수 있습니다. 기존 연동에서 쓰던 모델에 맞춰 전환 문서를 확인하세요.
흔한 실수
가격·성능 수치는 측정 대상을 구분해서 읽어야 합니다. 단가, 작업 비용, 평가 점수는 서로 다른 지표입니다. 다음처럼 구분하면 비교 조건을 유지할 수 있습니다.
| 혼동하기 쉬운 해석 | 확인된 의미 |
|---|---|
| 모든 청구액이 40% 감소 | 기본 설정의 일반적인 작업에 대한 추정치 |
| 캐시를 쓰면 전체 비용이 60% 감소 | 캐시 읽기 단가만 60% 인하 |
| 성능이 14.1% 상승 | Terminal-Bench 점수가 14.1%포인트 상승 |
| 모든 작업이 30% 빨리 완료 | 출력 생성 속도가 30% 넘게 향상 |
| 실제 사고가 85% 감소 | 특정 평가의 경계 우회 시도가 약 85% 감소 |
완료한 작업당 비용 비교
모델을 선택할 때는 검토를 통과한 작업당 비용을 비교하세요. 토큰 단가만으로 재시도와 수정 부담을 알기는 어렵습니다. 이는 발표 수치를 실제 업무에 적용하기 위한 비교 방법입니다.
계산 기준은 전체 실행 비용을 검토 통과 작업 수로 나누는 방식입니다. 실패한 시도의 비용도 전체 실행 비용에 포함하세요. 사람의 검토 시간은 별도 항목으로 기록하면 비교에 도움이 됩니다.
- 같은 작업 목록과 완료 기준 사용
- 일반 입력·캐시·출력 비용 구분
- 실패와 재시도를 포함한 총비용 기록
- 최종 검토 통과 여부 기록
- 실행 시간과 사람의 수정 시간 구분
FAQ
Claude Opus 5.5는 언제 공개됐나요?
Anthropic은 2026년 9월 22일 Claude Opus 5.5를 공개했습니다.
Claude Opus 5.5의 표준 API 가격은 얼마인가요?
공개 당시 100만 토큰당 입력 4달러, 출력 20달러입니다. 두 단가는 Opus 5보다 각각 20% 낮습니다.
비용이 항상 40% 줄어드나요?
40%는 Anthropic이 일반적인 작업에서 산출한 추정치입니다. 실제 절감률은 토큰 사용량과 캐시 활용에 따라 달라집니다.
캐시 읽기 가격은 얼마나 낮아졌나요?
100만 토큰당 0.50달러에서 0.20달러로 낮아졌습니다. 읽기 단가의 인하율은 60%입니다. 캐시 생성 비용은 별도로 확인해야 합니다.
컴퓨터 사용 평가의 정확한 이름은 무엇인가요?
공식 발표의 평가명은 OSWorld 2.1입니다. Opus 5.5 점수는 81.8%이며 partial 표시가 붙어 있습니다.
안전성 수치 85%는 사고 감소율인가요?
특정 평가에서 격리 경계를 우회하려는 시도가 약 85% 줄었다는 의미입니다. 실제 서비스의 사고 감소율을 뜻하지는 않습니다.
기존 API에서 모델명만 바꾸면 되나요?
기존 요청 설정에 따라 추가 수정이 필요합니다. 추론 설정과 강제 도구 호출, 응답 블록 처리 방식을 전환 문서에서 확인하세요.
AWS와 Google Cloud에서도 사용할 수 있나요?
출시 발표에는 AWS, Google Cloud, Microsoft Azure 지원이 포함됐습니다. 모델 식별자와 기능 지원 조건은 각 플랫폼에서 확인하세요.
출력 속도 향상과 작업 시간 단축은 같은 의미인가요?
서로 다른 지표입니다. 출력 생성 외에 도구 실행과 테스트가 포함되면 전체 완료 시간은 달라집니다.
Sources
Images


