평범한 사업가YOUTUBE SUMMARIES · 2026-09-25 · 평범한 사업가🎬 영상

Claude Opus 5.5의 40% 절감은 기본 설정과 작업 조건에 달려 있다.

Opus 5.5의 40% 절감은 medium·캐시 조건에서만 성립하며 max에서는 효과가 작다.

01핵심 개요

  • Claude Opus 5.5는 100만 토큰 컨텍스트와 12만8천 토큰 최대 출력을 제공하며, 입력·출력 가격은 각각 4달러·20달러다.
  • Opus 5 대비 토큰 단가는 20% 인하됐고 캐시 리드는 0.50달러에서 0.20달러로 60% 낮아졌다.
  • Terminal-Bench 4.0에서 Opus 5.5는 66.4%를 기록했지만, AutomationBench와 과학 터미널 벤치에서는 Astra가 앞섰다.
  • Anthropic의 40% 절감은 기본 effort와 전형적 작업 조건의 주장으로, max effort에서는 Opus 5와 태스크 비용이 거의 같다.
  • 영상은 일상 코딩·디버깅에는 medium, 장기 난제·연구 에이전트에는 Fable 5.1을 제시하며 라우팅을 권한다.

02핵심 주장 / 논점 구조

  • Opus 5.5는 더 싼 Fable 5.1이 아니라 감독하는 일상 코딩 에이전트의 새 기본값이라는 결론을 제시한다.
  • 40% 절감은 토큰 단가 인하, 캐시 리드 할인, 턴 감소와 캐시 유지가 함께 작동하는 조건부 수치다.
  • 기본값은 medium으로 두고, 막힌 문제에서만 max를 쓰며 Fable 5.1·GPT-6 Sol과 작업을 나누라고 권한다.

03출시 사양과 제공 환경

  • Opus 5.5는 Claude 5.5 패밀리의 첫 모델이며 Sonnet 5.5와 Haiku 5.5는 몇 주 안에 뒤따른다고 발표됐다.
  • 모델 아이디는 claude-opus-5-5이며, 컨텍스트는 100만 토큰, 최대 출력은 12만8천 토큰, 지식 기준은 2026년 6월이다.
  • Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry에서 제공되며 장시간 에이전트 코딩과 지식 업무용으로 소개됐다.
  • Fast mode는 입력 8달러·출력 40달러로 최대 2.5배이며 Claude API 리서치 프리뷰로만 제공된다.

04가격표와 40% 절감의 계산 조건

  • Opus 5.5의 입력·출력 100만 토큰 가격은 4달러·20달러로, Opus 5의 5달러·25달러보다 각각 20% 낮다.
  • 캐시 리드는 0.50달러에서 0.20달러로 60% 낮아졌고, 5분 캐시 라이트는 5달러, 1시간 캐시 라이트는 8달러다.
  • Addy Osmani의 같은 토큰 예시에서는 Opus 5 비용 3.50달러가 가격 변화만으로 약 31% 낮아진다고 설명했다.
  • Artificial Analysis의 max effort 계산에서는 캐시 리드 할인 후 Opus 5.5 비용이 5.98달러로, Opus 5 max의 5.86달러와 거의 같다.

05벤치마크 성능과 비교의 한계

  • Terminal-Bench 4.0에서 Opus 5.5는 66.4%로 Fable 5.1의 55.8%, GPT-6 Astra의 57.9%, GPT-5.6 Sol의 37.3%보다 높았다.
  • FrontierCode는 54.4%, CursorBench는 57.8%, 지식 업무 Elo는 1846으로 Fable의 1735보다 높게 제시됐다.
  • AutomationBench에서는 Astra가 41.4%, Opus 5.5가 40.0%였고 과학 터미널 벤치도 Astra 64.6%, Opus 5.5 58.7%였다.
  • Anthropic은 이 성능대의 벤치 점수 차이가 실사용 차이를 과장할 수 있으며 Opus 5.5와 Fable의 격차가 숫자보다 좁다고 적었다.

06effort 설정과 테스터 사례

  • 공식 표에서 별도 표시가 없으면 Opus 5.5는 max effort의 적응형 생각이며 Terminal-Bench 4.0만 xhigh로 표기됐다.
  • FrontierCode medium은 54.6%로 Astra 최고점 53.3%보다 높고 태스크 비용은 약 5분의 1이라고 소개됐다.
  • CursorBench medium은 52.5%로 Fable max의 51.8%보다 조금 높으며, 표의 Opus 5.5 57.8%는 max 수치다.
  • Anthropic이 전한 사례에서 20만 줄 감사는 Opus 5에서 20시간 이상·2.5배 토큰이 들었고, Opus 5.5에서는 3시간 미만이었다.
  • HAProxy를 C에서 Rust로 옮긴 내부 테스트는 Fable 12시간, Opus 5.5 9시간 반이었고 비용은 51% 적었다.

07모델 라우팅과 API 사용 시 변경점

  • 감독하는 일상 코딩과 기능·디버깅에는 Opus 5.5 medium, 짧은 수정에서 속도가 필요할 때는 Fast mode를 제안했다.
  • 혼자 오래 도는 난제와 연구 에이전트에는 입력 10달러·출력 50달러인 Fable 5.1을 제시했다.
  • 단가가 민감하면 GPT-6 Sol의 입력 2달러·출력 10달러, 또는 Luna의 0.10달러·0.50달러를 선택지로 들었다.
  • 생각은 끌 수 없고 깊이는 effort로만 조절하며, Opus 5의 기본 high와 달리 Opus 5.5의 기본값은 medium이다.
  • 강제 도구 선택은 400 오류이며 Claude API와 Google Cloud에서는 옛 컴퓨터 도구가 거부되고 Bedrock에서는 그대로 작동한다.

08용어 사전

용어뜻
Opus 5.5Claude 5.5 패밀리의 첫 모델로, 장시간 에이전트 코딩과 지식 업무용으로 소개된 모델이다.
effort모델의 생각 깊이를 조절하는 설정으로, 영상은 Opus 5.5의 기본값으로 medium을 권한다.
캐시 리드에이전트의 긴 세션 비용에 영향을 주는 항목으로, Opus 5.5에서는 100만 토큰당 0.20달러다.
Fast modeOpus 5.5에서 입력 8달러·출력 40달러를 받으며 최대 2.5배 속도를 내는 Claude API 리서치 프리뷰다.
Fable 5.1장기 난제와 연구 에이전트용 선택지로 언급됐으며, 입력·출력 가격은 100만 토큰당 10달러·50달러다.
Vals RSI 인덱스9월 22일 차트에서 Opus 5.5를 37.13%로 1위에 올렸지만 의료 코드 등 여러 항목의 회귀도 공개한 지표다.
평범한 사업가 · 2026-09-25
← 목록으로