무엇이 언제 나왔나

Anthropic은 2026년 9월 22일 Claude Opus 5.5를 공개했고, 9월 28일 Sonnet 5.5를 이어 공개했다. 회사 설명상 Opus는 복잡한 판단과 장시간 에이전트 작업, Sonnet은 일상적인 코딩·문서·슬라이드·스프레드시트 작업에 초점을 둔다. 같은 5.5 계열이지만 “싼 Opus”와 “조금 약한 Opus”로만 보면 용도를 놓친다.

Claude Opus 5.5와 Sonnet 5.5의 용도와 공식 발표 수치를 비교한 그림
공식 포지션 기준으로 Sonnet은 자주 쓰는 업무, Opus는 오래 걸리고 판단이 복잡한 작업에 놓였다.

Opus 5.5: 가격과 속도가 같이 바뀌었다

Anthropic 발표에 따르면 Opus 5.5 API 가격은 입력 100만 토큰당 4달러, 출력 20달러이며 캐시 읽기는 0.20달러다. Opus 5보다 입력·출력 단가는 20%, 캐시 읽기는 60% 낮다. 회사 내부 시험에서는 기본 설정의 일반 작업 비용이 약 40% 줄고 출력 속도는 30% 이상 빨라졌다고 밝혔다. 이 수치는 Anthropic의 자체 시험 결과이므로 모든 사용자 작업에서 그대로 재현된다는 뜻은 아니다.

공식 벤치마크도 에이전트 코딩, 컴퓨터 사용, 지식 업무에서 큰 개선을 제시한다. 하지만 Anthropic 스스로 모델 간 점수 차이가 현실의 체감 차이를 과장할 수 있다고 적었다. 출시 소식에서 중요한 숫자는 최고 점수 하나보다 같은 일을 몇 단계와 몇 토큰으로 끝내는가다.

첫 사용자 반응은 좋지만 한쪽으로만 모이지 않았다

Claude 사용자 커뮤니티에서는 Claude Code의 속도와 맥락 유지, 글쓰기 톤이 좋아졌다는 반응이 빠르게 나왔다. 간단한 지시로 제품 영상을 만들거나, 이전 모델보다 적은 토큰으로 코딩 명세를 처리했다는 사례도 있었다. 반대로 이력서 작업처럼 사용자의 의도를 읽는 문제에서는 4.6이 더 나았다는 평가, 여전히 실수가 남는다는 반론도 있었다.

여기서 확인되는 건 “5.5가 무조건 최고”가 아니다. 출시 첫날의 감탄은 복잡한 작업에서 나온 경우가 많고, 섬세한 편집 판단이나 익숙한 말투에서는 구형 모델을 선호하는 사용자도 있다. 일주일도 안 된 시점의 보고는 첫인상이지 장기 안정성 평가가 아니다.

Claude Opus 5.5 사용자 반응의 장점과 주의점을 나눈 그림
빠름·긴 작업·글쓰기 개선이라는 반응 옆에 판단 실수와 출시 직후 과대평가 가능성도 같이 남긴다.

Sonnet 5.5는 누구에게 맞나

Sonnet 5.5는 공개된 지 하루밖에 지나지 않아 독립 사용자 사례가 충분히 쌓이지 않았다. 공식 발표에서는 Sonnet 5보다 30% 이상 빠르고, 일반 작업 비용이 최대 30% 낮으며, 버그 수정·문서·슬라이드·스프레드시트 같은 일상 업무를 주력으로 제시한다. 장기 코드 마이그레이션이나 애매한 판단이 많은 프로젝트는 Opus, 자주 반복하는 일반 업무는 Sonnet이라는 구분이 현재 가장 안전하다.

지금 바꿔도 되는 사람, 기다릴 사람

  1. 큰 저장소를 오래 돌리거나 도구 호출 비용이 큰 사람은 Opus 5.5를 같은 작업으로 비교해 볼 가치가 크다.
  2. 문서·메일·표·간단한 수정이 대부분이면 Sonnet 5.5부터 시험하는 편이 비용을 통제하기 쉽다.
  3. 말투와 미묘한 편집 판단이 중요하면 기존 모델과 같은 원문으로 나란히 비교한다.
  4. 프로덕션 자동화는 1~2주 동안 실패율과 재작업 횟수를 기록한 뒤 바꾼다.
현재 판정

Opus 5.5의 핵심은 단순한 성능 상승보다 고난도 작업의 단계·토큰·시간을 줄이려는 변화다. 다만 Sonnet 5.5의 현실 평가는 아직 사용자 사례가 부족하다. 공식 발표와 첫 반응을 구분해서 봐야 한다.