평범한 사업가YOUTUBE SUMMARIES · 2026-09-25 · 평범한 사업가🎬 영상
Claude Opus 5.5의 40% 절감은 기본 설정과 작업 조건에 달려 있다.
Opus 5.5의 40% 절감은 medium·캐시 조건에서만 성립하며 max에서는 효과가 작다.
01핵심 개요
- Claude Opus 5.5는 100만 토큰 컨텍스트와 12만8천 토큰 최대 출력을 제공하며, 입력·출력 가격은 각각 4달러·20달러다.
- Opus 5 대비 토큰 단가는 20% 인하됐고 캐시 리드는 0.50달러에서 0.20달러로 60% 낮아졌다.
- Terminal-Bench 4.0에서 Opus 5.5는 66.4%를 기록했지만, AutomationBench와 과학 터미널 벤치에서는 Astra가 앞섰다.
- Anthropic의 40% 절감은 기본 effort와 전형적 작업 조건의 주장으로, max effort에서는 Opus 5와 태스크 비용이 거의 같다.
- 영상은 일상 코딩·디버깅에는 medium, 장기 난제·연구 에이전트에는 Fable 5.1을 제시하며 라우팅을 권한다.
02핵심 주장 / 논점 구조
- Opus 5.5는 더 싼 Fable 5.1이 아니라 감독하는 일상 코딩 에이전트의 새 기본값이라는 결론을 제시한다.
- 40% 절감은 토큰 단가 인하, 캐시 리드 할인, 턴 감소와 캐시 유지가 함께 작동하는 조건부 수치다.
- 기본값은 medium으로 두고, 막힌 문제에서만 max를 쓰며 Fable 5.1·GPT-6 Sol과 작업을 나누라고 권한다.
03출시 사양과 제공 환경
- Opus 5.5는 Claude 5.5 패밀리의 첫 모델이며 Sonnet 5.5와 Haiku 5.5는 몇 주 안에 뒤따른다고 발표됐다.
- 모델 아이디는 claude-opus-5-5이며, 컨텍스트는 100만 토큰, 최대 출력은 12만8천 토큰, 지식 기준은 2026년 6월이다.
- Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry에서 제공되며 장시간 에이전트 코딩과 지식 업무용으로 소개됐다.
- Fast mode는 입력 8달러·출력 40달러로 최대 2.5배이며 Claude API 리서치 프리뷰로만 제공된다.
04가격표와 40% 절감의 계산 조건
- Opus 5.5의 입력·출력 100만 토큰 가격은 4달러·20달러로, Opus 5의 5달러·25달러보다 각각 20% 낮다.
- 캐시 리드는 0.50달러에서 0.20달러로 60% 낮아졌고, 5분 캐시 라이트는 5달러, 1시간 캐시 라이트는 8달러다.
- Addy Osmani의 같은 토큰 예시에서는 Opus 5 비용 3.50달러가 가격 변화만으로 약 31% 낮아진다고 설명했다.
- Artificial Analysis의 max effort 계산에서는 캐시 리드 할인 후 Opus 5.5 비용이 5.98달러로, Opus 5 max의 5.86달러와 거의 같다.
05벤치마크 성능과 비교의 한계
- Terminal-Bench 4.0에서 Opus 5.5는 66.4%로 Fable 5.1의 55.8%, GPT-6 Astra의 57.9%, GPT-5.6 Sol의 37.3%보다 높았다.
- FrontierCode는 54.4%, CursorBench는 57.8%, 지식 업무 Elo는 1846으로 Fable의 1735보다 높게 제시됐다.
- AutomationBench에서는 Astra가 41.4%, Opus 5.5가 40.0%였고 과학 터미널 벤치도 Astra 64.6%, Opus 5.5 58.7%였다.
- Anthropic은 이 성능대의 벤치 점수 차이가 실사용 차이를 과장할 수 있으며 Opus 5.5와 Fable의 격차가 숫자보다 좁다고 적었다.
06effort 설정과 테스터 사례
- 공식 표에서 별도 표시가 없으면 Opus 5.5는 max effort의 적응형 생각이며 Terminal-Bench 4.0만 xhigh로 표기됐다.
- FrontierCode medium은 54.6%로 Astra 최고점 53.3%보다 높고 태스크 비용은 약 5분의 1이라고 소개됐다.
- CursorBench medium은 52.5%로 Fable max의 51.8%보다 조금 높으며, 표의 Opus 5.5 57.8%는 max 수치다.
- Anthropic이 전한 사례에서 20만 줄 감사는 Opus 5에서 20시간 이상·2.5배 토큰이 들었고, Opus 5.5에서는 3시간 미만이었다.
- HAProxy를 C에서 Rust로 옮긴 내부 테스트는 Fable 12시간, Opus 5.5 9시간 반이었고 비용은 51% 적었다.
07모델 라우팅과 API 사용 시 변경점
- 감독하는 일상 코딩과 기능·디버깅에는 Opus 5.5 medium, 짧은 수정에서 속도가 필요할 때는 Fast mode를 제안했다.
- 혼자 오래 도는 난제와 연구 에이전트에는 입력 10달러·출력 50달러인 Fable 5.1을 제시했다.
- 단가가 민감하면 GPT-6 Sol의 입력 2달러·출력 10달러, 또는 Luna의 0.10달러·0.50달러를 선택지로 들었다.
- 생각은 끌 수 없고 깊이는 effort로만 조절하며, Opus 5의 기본 high와 달리 Opus 5.5의 기본값은 medium이다.
- 강제 도구 선택은 400 오류이며 Claude API와 Google Cloud에서는 옛 컴퓨터 도구가 거부되고 Bedrock에서는 그대로 작동한다.
08용어 사전
| 용어 | 뜻 |
|---|
| Opus 5.5 | Claude 5.5 패밀리의 첫 모델로, 장시간 에이전트 코딩과 지식 업무용으로 소개된 모델이다. |
| effort | 모델의 생각 깊이를 조절하는 설정으로, 영상은 Opus 5.5의 기본값으로 medium을 권한다. |
| 캐시 리드 | 에이전트의 긴 세션 비용에 영향을 주는 항목으로, Opus 5.5에서는 100만 토큰당 0.20달러다. |
| Fast mode | Opus 5.5에서 입력 8달러·출력 40달러를 받으며 최대 2.5배 속도를 내는 Claude API 리서치 프리뷰다. |
| Fable 5.1 | 장기 난제와 연구 에이전트용 선택지로 언급됐으며, 입력·출력 가격은 100만 토큰당 10달러·50달러다. |
| Vals RSI 인덱스 | 9월 22일 차트에서 Opus 5.5를 37.13%로 1위에 올렸지만 의료 코드 등 여러 항목의 회귀도 공개한 지표다. |