앤스로픽 손넷 5.5 출시, 오퍼스급 성능을 절반 값에… 단, '토큰 절약'이 열쇠다
앤스로픽이 클로드 손넷 5.5를 정식 출시했다. 오퍼스 5.5에 이은 5.5 패밀리 두 번째 모델이다. 제조사 발표에 따르면 터미널 벤치마크(Terminal-Bench 4.0) 70.6%로 오퍼스 5.5를 앞섰고, API 목록가는 손넷 5와 같은 입력 100만 토큰당 2달러, 출력 100만 토큰당 10달러로 유지됐다. 오퍼스 5.5의 절반 수준이다.
벤치마크 수치만 보면 오퍼스를 넘었다
공개된 벤치마크는 모두 앤스로픽 자체 측정이다. 터미널 벤치마크 70.6%는 오퍼스 5.5보다 높은 점수다. 다만 같은 자료에서 "오퍼스 5.5는 복잡하고 열린 작업에서 여전히 명확히 강하다"고 못 박았다. 최고 노력도(Max)에서 오히려 점수가 떨어지는 현상도 나타났다. 멀티 에이전트 코드 리뷰를 자주 시도하다 타임아웃이나 범위 밖 수정이 생겨 감점됐다는 설명이다.
'절반 가격'의 실체는 요금 인하가 아니다
목록가는 손넷 5 시절과 똑같다. 그런데 발라스니 자산운용 측정 결과, 손넷 5.5는 답변 하나당 약 12만 1천 토큰을 썼다. 손넷 5는 49만 7천 토큰이었다. 토큰 사용량이 4분의 1로 줄었다. 베이스44는 앱 빌드 1회당 반복 횟수가 3.6회로, 오퍼스 5의 7.7회보다 절반 이하였다. 젠데스크는 티켓 처리 속도가 20% 빨라졌다.
즉, 스티커 가격은 그대로인데 같은 일을 훨씬 적은 토큰으로 끝낸다는 뜻이다. 앤스로픽도 "절감 효과는 토큰 효율에서 온다, 가격 인하가 아니다"라고 명시했다. 실제 비율은 워크로드마다 다르다.
노력도 기본값이 인터페이스마다 다르다
클로드 코드와 클로드 앱은 기본 '미디엄', 클로드 플랫폼(개발자 콘솔)은 기본 '하이'로 설정돼 있다. 노력도가 높을수록 추론 시간이 길고 토큰도 많이 쓴다. 개발자가 콘솔에서 기본값 그대로 쓰면 미디엄 대비 비용이 뛸 수 있다. 마이그레이션 가이드에서 노력도 조정을 권장하는 이유다.
한국에서 쓰려면: 클라우드 콘솔 경로가 유력
자체 호스팅은 불가능한 폐쇄 가중치 모델이다. 클로드 플랫폼 외에 AWS, 구글 클라우드, 마이크로소프트 애저에서 바로 호출할 수 있다. 국내 기업이라면 세 클라우드 모두 서울 리전을 운영 중이므로, 기존 클라우드 계약에 얹어 쓰기가 가장 빠르다. 별도 가입 없이 콘솔에서 모델 이름(claude-sonnet-5-5)만 바꾸면 된다.
앞서 본 앤스로픽의 기업 시장 고전, 이번엔 다를까
본지가 35일 전 다룬 앤스로픽 최상위 모델 '파블', 기업 외면…Ramp 데이터가 보여준 '가격·통합'의 벽에서는 오퍼스급 최상위 모델이 비싼 API 요금과 통합 난이도 탓에 기업 결제 데이터에서 밀렸다. 손넷 5.5는 가격 장벽을 토큰 효율로 우회했고, 3대 클라우드 네이티브 지원으로 통합 장벽도 낮췄다. 이번엔 기업 채택 곡선이 다를지 지켜볼 대목이다.
쉽게 풀어보면
앤스로픽이 새 모델 클로드 손넷 5.5를 내놨습니다. 앞서 나온 최상위 모델 오퍼스 5.5와 코딩 실력이 거의 같은데, API 사용 요금은 절반 수준입니다.
비결은 **'말을 적게 해서 일을 끝낸다'**는 겁니다. 같은 코딩 과제를 주고 토큰(모델이 읽고 쓰는 최소 단위) 사용량을 쟀더니, 구형 손넷 5는 답 하나에 약 50만 토큰을 썼는데 손넷 5.5는 12만 토큰만 썼습니다. 4분의 1로 줄었습니다. 요금제는 토큰당 과금이니, 자연히 청구서도 4분의 1로 줄어듭니다.
단, 이건 '코딩 같은 정해진 과제'에서 그렇습니다. "복잡하고 정답이 열려 있는 작업"은 여전히 오퍼스 5.5가 강하다고 앤스로픽 스스로 인정했습니다. 또 개발자 콘솔에서는 기본 설정이 '높은 노력도'라 토큰을 더 많이 쓸 수 있으니, 비용이 민감하면 '미디엄'으로 낮춰 쓰는 게 안전합니다.
한국 기업 입장에선 반가운 점이 있습니다. 이 모델을 쓰려고 서버를 새로 둘 필요 없습니다. 이미 쓰는 AWS·구글 클라우드·애저 콘솔에서 모델 이름만 claude-sonnet-5-5로 바꾸면 바로 됩니다. 서울 리전에서도 돌아갑니다.
나에게 미치는 영향
챗GPT나 클로드 웹·앱으로 코딩 도움을 받는 직장인·학생이라면
- 지금 쓰는 채팅창에서 모델을 'Sonnet 5.5'로만 바꿔 보세요. 기본 노력이 '미디엄'이라 속도와 비용 균형이 맞춰져 있습니다. 답변이 너무 길거나 느리면 새 대화창에서 "짧게 답해줘" 한 마디만 덧붙이면 토큰을 아낍니다.
내부 도구에 클로드 API를 붙여 쓰는 개발자·스타트업이라면
- 콘솔 기본값이 '하이'라 비용이 뛸 수 있습니다. 마이그레이션 가이드 권장대로
thinking.effort: "medium"으로 고정하세요. - 기존 손넷 5 프롬프트를 그대로 쓰면 토큰이 남습니다. 발라스니 사례는 모델 교체만으로 4분의 1 감소를 보였습니다.
- 오퍼스 5.5를 쓰던 워크로드 중 '정해진 스펙 구현, 버그 수정, 문서 정리' 류는 손넷 5.5로 내려도 품질 차이 거의 없습니다. 월 청구서가 절반 이하로 떨어질 가능성이 큽니다.
아직 기다려도 되는 경우
- 오픈소스 모델로 자체 서버 돌려야 하는 조직(폐쇄 가중치라 불가)
- "정답이 없는 기획·설계·리서치"가 주 업무인 팀 — 여전히 오퍼스 5.5가 우위
- 현재 손넷 5로도 비용·속도 모두 만족 중인 팀 — 마이그레이션 비용 대비 이득을 먼저 계산하세요
남은 검증 포인트
벤치마크 70.6%는 제조사 자체 측정입니다. 제3자 독립 평가(아티피셜 어낼리시스 등)가 나오면 실력 차가 좁혀지는지, 벌어지는지 확인해야 합니다. 또 '토큰 4분의 1' 수치는 발라스니·베이스44·젠데스크 세 곳 사례입니다. 범용 업무(번역, 요약, 일반 질의)에서도 같은 효율이 나오는지는 아직 공개되지 않았습니다.
이 기사의 출처
- r/ClaudeAISonnet 5.5 did this. Opus 5.5 quality with half price.
- Anthropic 뉴스Claude Sonnet 5.5 scores 70.6% on Terminal-Bench, above Opus 5.5 at half the price - MIXED Reality News
- Anthropic 뉴스Anthropic launches Claude Sonnet 5.5 with near-Opus performance at half the price - The New Stack
- Anthropic 뉴스Anthropic's Claude Sonnet 5.5 Is Out, Beats Opus 5.5 at Coding for Half the Price - Decrypt
- MarkTechPostAnthropic Releases Claude Sonnet 5.5: 70.6% on Terminal-Bench 4.0 at the Same $2/$10 Price
이 글은 위 원문과 커뮤니티 반응을 바탕으로 AI의 도움을 받아 작성했으며, 발행 전 사람이 확인합니다. 사실관계는 원문 링크에서 직접 확인하실 수 있습니다.