/

한줄 요약

Claude Opus 5.5(모델 ID claude-opus-5-5, 2026-09-22)는 CursorBench 4.0에서 Medium 기본값만으로도 Fable 5.1 Max보다 높은 점수·훨씬 낮은 비용을 보여주는 에이전트 코딩 모델입니다. Medium 52.5% / $2.91이 Fable Max 51.8% / $17.28을 앞서고, Max 57.8%가 1위입니다. 이 글은 Opus 5·Fable 5.1과의 갈라쓰기, 사람·개발자 체감, 역할 가이드만 정리합니다.

숫자·표는 cursor.com/cursorbench CursorBench 4.0 기준이며, 제품 스펙은 Anthropic Claude Opus 5.5와 Cursor 모델 문서(Opus 5.5, Fable 5)를 따릅니다. 벤치 점수는 분산이 있으므로 순위를 절대값으로만 읽지 마십시오.

한 줄로: Opus가 Fable급을 싸게 가져온 의미는?

한 줄 답: 기본 Medium만으로도 Fable Max급 점수에 가까운 품질을, 과제당 비용의 약 1/6 수준으로 쓸 수 있게 되었다는 뜻입니다.

에이전트 코딩에서는 “최고 품질”과 “매일 돌릴 수 있는 비용”이 동시에 필요합니다. 이전에는 Fable Max로 품질을 올리려면 과제당 $17대 비용이 따라왔고, Opus 5 Max는 $11대에서도 CursorBench가 46.6%에 머물렀습니다. Opus 5.5는 그 간극을 Medium·High 구간에서 메웁니다. Cursor도 사고(thinking)는 high를 권장하며, Opus 가격대에서 CursorBench 최상단을 기록한다고 안내합니다.

사람에게 미치는 영향은?

한 줄 답: 긴 에이전트 루프를 더 자주·더 오래 돌릴 수 있고, 같은 예산으로 검증·수정 턴을 늘릴 여지가 생깁니다.

  • 에이전트 코딩: 탐색→패치→테스트→재시도를 여러 턴 이어 갈 때, “품질은 Fable급에 가깝고 비용은 Opus 쪽”인 선택이 됩니다. 레포 단위 리팩터, flaky 재현, PR 준비처럼 컨텍스트가 긴 작업에 맞습니다.
  • 장시간 루프: 1M 컨텍스트·128K 출력과 adaptive thinking(기본 effort medium)으로, 세션을 자주 끊지 않고도 한 흐름을 유지하기 쉽습니다.
  • 비용: API 기준 입력/출력 $4 / $20 MTok(캐시 읽기 $0.20). Anthropic 포지션상 Opus 5 대비 전형 워크로드에서 약 40% 저렴·출력 약 30%+ 빠릅니다. CursorBench 과제당 비용으로 보면 Medium $2.91이 Fable Max $17.28을 크게 밑돕니다.
체감은 “한 번에 완벽한 답”보다 같은 예산으로 몇 번 더 돌릴 수 있는가에 가깝습니다. 에이전트 워크플로에서는 재시도 횟수가 곧 품질입니다.

Opus 5와 5.5는 뭐가 다른가?

한 줄 답: 같은 Opus 라인에서 가격·속도·벤치가 한 단계 올라간 후속이며, daily driver 후보가 Opus 5에서 5.5로 옮겨 가기 쉬운 쪽입니다.

항목Opus 5Opus 5.5
모델 IDclaude-opus-5 (제품 표기)claude-opus-5-5
컨텍스트 / 출력제품·플랜별1M / 128K (Anthropic 안내)
API 단가 (in/out)이전 Opus 세대$4 / $20 MTok, 캐시 읽기 $0.20
사고(effort)세대별adaptive thinking, 기본 medium; Cursor는 high 권장
CursorBench Max46.6% / $11.9557.8% / $13.43 (#1)
품질 포지션이전 Opus daily대부분 작업에서 Fable급에 가깝다 (Anthropic)
체감 변화—전형 워크로드 ~40% 저렴, 출력 ~30%+ 빠름

정리하면, Opus 5를 쓰던 팀·개인이 “품질은 올리고 싶지만 Fable Max 비용은 부담”일 때 5.5가 자연스러운 다음 단계입니다. CursorBench만 봐도 Opus 5 Max(46.6%)와 Opus 5.5 Medium(52.5%) 사이 간격이 이미 큽니다.

Fable 5.1과 Opus 5.5는 언제 갈라쓰나?

한 줄 답: 일반·ZDR 팀의 기본 daily는 Opus 5.5, 데이터 보존( retention ) 옵트인이 가능한 조직에서 Fable만의 강점이 필요할 때 Fable을 남깁니다.

Cursor 문서 기준 차이는 다음과 같습니다.

  • Opus 5.5(cursor.com/docs/models/claude-opus-5-5.md): ZDR 호환. Fable 5.1과 달리 일반 접근에 데이터 보존 요구가 없고, 기존에 Opus로 ZDR을 쓰던 팀은 5.5에서도 그 정책을 유지할 수 있습니다. Cursor는 high thinking을 권장하며, Opus 가격대에서 CursorBench 최상단을 기록한다고 안내합니다.
  • Fable 5.1(cursor.com/docs/models/claude-fable-5): Privacy Mode여도 Anthropic 데이터 보존 옵트인(약 30일 안전 보존)이 필요하며, 팀 단위 옵트인입니다.
상황권장이유
개인·스타트업 daily 에이전트Opus 5.5 High(또는 Medium)점수·비용·ZDR 부담이 적음
엔터프라이즈 ZDR / 데이터 거주 정책Opus 5.5 유지ZDR 호환, retention 옵트인 불필요
팀 전체가 retention 옵트인 가능 + Fable 특화 워크로드Fable 5.1정책 허용 시에만; 비용은 Max 기준 더 높음
초고난도 한 방Opus 5.5 MaxCursorBench 57.8% (#1)
정책·데이터 보관 요구에 따라 Fable을 남기는 조직이 있습니다. 팀 정책이 retention 옵트인을 허용하지 않으면 Opus 5.5가 기본축입니다. 세부 정책은 cursor.com/docs와 조직 보안 가이드를 확인하십시오.

CursorBench 4.0 결과는?

한 줄 답: Opus 5.5 Medium(52.5% / $2.91)이 이미 Fable 5.1 Max(51.8% / $17.28)를 앞서고, Max(57.8%)가 1위입니다.

CursorBench 4.0 Accuracy-vs-cost / leaderboard — publish bot captures from cursor.com/cursorbench
ModelScoreCost/task
Opus 5.5 Max57.8%$13.43
Opus 5.5 Extra High56.0%$6.98
Opus 5.5 High56.0%$3.97
Opus 5.5 Medium52.5%$2.91
Fable 5.1 Max51.8%$17.28
Fable 5.1 Medium46.8%$7.05
Opus 5 Max46.6%$11.95
GPT-5.6 Sol Max41.7%$8.23

해석 포인트는 세 가지입니다.

  1. 기본값(Medium)이 이미 Fable Max를 이김: 52.5% / $2.91 vs 51.8% / $17.28.
  2. Max가 1위: 57.8% / $13.43. 비용은 Fable Max보다 낮고 점수는 더 높습니다.
  3. Sol Max 대비: Opus Medium은 Sol Max(41.7%)보다 약 +11pt, 비용은 $2.91 vs $8.23으로 대략 1/3입니다.

출처: https://cursor.com/cursorbench. CursorBench는 과제·분산에 따라 순위가 흔들릴 수 있으니, 표는 “방향성”으로 읽고 실제 레포 평가로 확인하십시오. Cursor는 thinking high를 권장합니다.

앞으로 Opus는 어떤 역할로?

한 줄 답: Cursor daily는 High, 비용 민감은 Medium, 초고난도는 Max, 짧은·단순 작업은 Sonnet입니다.

Daily · High
Cursor 권장 thinking. 에이전트 코딩·긴 루프의 기본축.
비용 민감 · Medium
기본 effort. CursorBench 52.5% / $2.91으로 Fable Max를 이미 상회.
초고난도 · Max
한 방 품질이 필요할 때. CursorBench 57.8% (#1).
짧은 작업 · Sonnet
단순 수정·설명·짧은 패치. Opus를 쓸 필요가 없을 때.

Fable을 “완전 대체”하기보다, 정책이 허용하는 범위에서 Opus 5.5를 daily로 두고 Fable은 옵트인 가능한 특수 축으로 남기는 구성이 현실적입니다. ZDR·데이터 거주가 있는 조직은 Opus 쪽이 기본입니다.

한 줄로 정리하면?

한 줄 답: Opus 5.5는 Fable급 에이전트 코딩을 Opus 가격·속도로 가져온 모델이며, CursorBench상 Medium만으로도 Fable Max를 이깁니다.

옮길 때 체크리스트:

  1. Cursor/Claude Code에서 모델 ID가 claude-opus-5-5인지 확인합니다.
  2. Daily는 High(권장), 예산이 타이트하면 Medium부터 측정합니다.
  3. 팀 ZDR·retention 정책을 보고 Fable 옵트인 여부를 결정합니다.
  4. 짧은 작업은 Sonnet에 두고, Opus는 긴 에이전트 루프에 씁니다.

공식 링크: anthropic.com/claude-opus-5-5 · cursor.com/cursorbench · Opus 5.5 docs · Fable docs.

Cursor·Claude Code 구독 경로가 필요하면 Gamsgo 파트너 허브(코드 NUFUY) 또는 티스토리 /129 허브를 참고하십시오. 본문 내용과 무관한 할인이므로, 모델 선택 기준을 먼저 정한 뒤에 보시면 됩니다.

+ Recent posts