공부 / AI / claude

Opus

작성
수정

Claude의 Opus 모델이 4.8에서 5로 넘어오면서 무엇이 바뀌었는지, 그리고 상위 모델인 Fable과는 어떻게 다른지 정리한 노트입니다.

Opus 4.8 — Dynamic Workflows와 /effort

Anthropic은 Opus 4.8부터 정직성을 제품 기능으로 내세우기 시작했습니다. 불확실한 부분은 불확실하다고 표시하고 근거 없는 주장을 줄이는 방향인데, 자기가 짠 코드의 결함을 조용히 넘어가는 빈도가 Opus 4.7 대비 4배 낮아졌다고 합니다.

가장 큰 특징은 Dynamic Workflows라는 점입니다. 기존의 Claude Code는 코딩 에이전트 하나가 처음부터 끝까지 일하는 구조였는데, 이 기능이 들어오면서 작업마다 임시로 멀티에이전트 조직을 꾸리는 형태로 바뀌었습니다. 흐름은 planner가 계획을 세우고 그 계획을 orchestration 스크립트로 만든 뒤, 100개가 넘는 서브에이전트를 병렬로 돌리고 결과를 검증해서 최종 결과물을 내는 순서입니다.

예를 들어 React 코드를 Solid로 옮기는 마이그레이션 작업이라면 에이전트 10개가 각각 Opus 4.8(1M 컨텍스트)을 달고 파일 단위로 나눠서 작업하고 이걸 phase별로 진행합니다.

모델이나 컨텍스트를 키우는 것보다 작업을 잘게 나눠서 병렬로 처리하는 쪽이 더 잘 스케일된다는 게 이 방향의 철학입니다.

/effort 명령으로 추론 강도를 정할 수 있는데 low / medium / high / xhigh / max / ultracode 레벨이 있습니다. 단 max와 ultracode는 세션 전용이고, ultracode는 xhigh 추론에 workflow orchestration이 자동으로 붙는 레벨입니다.

Opus 4.8에서 Opus 5로 바뀐 것

Opus 5는 2026년 7월 24일에 출시됐습니다. Anthropic은 "사려깊고 능동적인 모델"이라고 소개했고, Fable 5의 프론티어 지능에 근접하는 성능을 절반 가격에 냅니다. 가격 자체는 4.8과 동일하게 백만 토큰당 입력 $5 / 출력 $25인데 성능만 크게 올랐습니다.

effort 레벨은 low부터 max까지 5단계로 정리됐고 기본값은 high입니다. thinking이 기본으로 켜지는데, 4.8에서는 옵션이었기 때문에 마이그레이션할 때 breaking change가 됩니다.

컨텍스트는 1M이 기본이자 최대인데도 추가 요금이 없고 프롬프트 캐시의 최소 단위도 512토큰으로 낮아졌습니다.

베타 기능도 2개 들어왔습니다.

  1. 대화 중간에 캐시를 유지한 채로 툴 구성을 바꿀 수 있습니다.
  2. 세이프티 분류기에 걸린 요청을 자동으로 다른 모델로 폴백시킵니다.

Fast 모드는 가격이 2배로 뛰는 대신 속도가 2.5배 빨라집니다.

벤치마크

Frontier-Bench v0.1에서 Opus 4.8의 2배 이상 성능을 더 낮은 비용으로 냈습니다. CursorBench 3.2(max effort)에서는 Fable 5 최고점과 0.5% 차이인데 비용은 절반이고, ARC-AGI 3에서는 차순위 모델의 3배 점수를 냈습니다. Zapier AutomationBench는 같은 비용 기준으로 약 1.5배 높은 통과율, OSWorld 2.0은 Fable 5 최고 결과를 1/3 비용으로 넘어섰습니다.

생명과학 쪽에서는 4.8 대비 유기화학이 +10.2%p, 단백질 기능 예측이 +7.7%p 올랐습니다.

안전성

Anthropic 내부 정렬 감사 기준으로는 역대 가장 잘 정렬된 모델이라고 하는데, 기만적 행동과 오용 취약성 둘 다 최저치입니다.

단 사이버보안은 여전히 Mythos 5보다 약합니다. 취약점을 발견하는 능력은 근접했지만 익스플로잇을 개발하는 능력은 크게 못 미치기 때문에 바이너리 기반 스캐닝, 침투테스트, 익스플로잇 생성은 차단됩니다. Fable 5와 비교하면 클래시파이어가 개입하는 빈도는 약 85% 줄었습니다.

생물학 분야는 4.8과 안전장치 수준이 같습니다. 이 덕분에 현재 공개된 모델 중에서는 과학 연구용으로 가장 강력하다고 할 수 있습니다. 장기 자율 연구는 여전히 Mythos 5가 더 강합니다.

Opus 5와 Fable 5.1의 차이

Opus 5는 Fable 한 단계 아래의 주력 모델이고, Fable 5.1은 Mythos급 최상위 모델의 일반 공개판입니다.

가격은 Opus 5가 백만 토큰당 $5 / $25, Fable 5.1이 $10 / $50입니다. 단 Fable은 캐시 읽기가 $0.25로 75% 인하됐습니다.

Opus 5는 일반 이용 시 데이터 보존 요건이 없어서 zero retention이 가능한데, Fable 5.1은 Covered Model이라 30일 보존이 필수이고 zero retention이 안 됩니다.

안전장치는 Opus 5가 자체 클래시파이어를 쓰고 사이버 관련 개입이 적은데, Fable 5.1은 사이버·생물 클래시파이어가 붙어 있고 거부가 나면 Opus로 자동 폴백됩니다.

적합한 용도로는 Opus 5가 일상 코딩과 업무에 매일 쓰는 드라이버이고, 며칠씩 걸리는 자율 작업이나 코드베이스 전체 리팩터링, 최고난도 지식노동은 Fable 5.1 쪽입니다. Opus 5는 체감 성능이 Fable 프론티어 지능에 근접해 있고 비용은 절반이지만, Fable 5.1은 Anthropic 최고 성능 모델이라 자기 결과물을 비전으로 직접 검증할 수 있습니다.

Mythos는 Fable과 같은 모델에서 세이프티 클래시파이어만 뺀 버전인데, Project Glasswing을 통해 승인된 조직만 접근할 수 있습니다.

마지막으로 정리하자면 매일 쓰는 작업은 Opus 5로 충분하고, 절대적인 지능 한계치가 필요한 초고난도·장기 작업만 Fable로 전환하는게 비용 대비 합리적입니다.