앤스로픽, 가장 싸고 빠른 '클로드 하이쿠 5.5' 공개…입력 토큰 100만 개당 0.1달러
앤스로픽이 클로드 하이쿠 5.5를 내놨다. 가장 저렴하고 빠른 소형 모델이라는 수식어를 달았다. 입력 토큰 100만 개당 0.10달러, 출력 100만 개당 0.40달러다. 100만 토큰 컨텍스트 창을 유지하면서 OSWorld 벤치마크 72.4%를 기록했다(출처: 앤스로픽 공식 블로그·보도자료).
요금표만 보면 파격적이다
자료에 따르면 이전 하이쿠 3.5 대비 around 75% lower cost다. 입력 전용인지 총비용인지는 발표문에서 분리하지 않았다. 티어드 프라이싱(단계별 요금)을 도입해 사용량에 따라 단가가 더 떨어진다. 기업이 대량 임베딩이나 분류 작업을 돌릴 때 부담이 확 줄어든다.
다만 출력 토큰 요금은 입력의 4배다. 긴 답변을 반복 요청하면 체감 비용이 뛸 수 있다. 이 부분은 발표문에 명시됐으나 강조되지 않았다.
'노력 조절'이 진짜 차별점이다
모델이 추론에 들이는 '노력(effort)' 단계를 3단계로 고를 수 있다. 낮음·중간·높음이다. 간단한 분류면 낮음으로 돌려 토큰과 시간을 아낀다. 복잡한 코드 리뷰면 높음으로 올려 정확도를 잡는다. 같은 모델에서 속도·비용·품질 트레이드오프를 사용자가 실시간으로 결정한다.
이 기능은 API 파라미터 한 줄로 작동한다. 챗 인터페이스에서는 아직 노출되지 않았다. 개발자 문서 확인 결과, thinking_budget 파라미터로 제어한다.
벤치마크 숫자만 보면 반쪽이다
OSWorld 72.4%는 컴퓨터 사용 능력 평가다. 파일 조작, 터미널 명령, 브라우저 자동화 같은 태스크를 얼마나 성공하는지 본다. 경쟁사 소형 모델과의 격차는 공개된 자료에서 확인되지 않았다.
실제 코딩 에이전트 작업에서 체감 차이는 다를 수 있다. 벤치마크는 정해진 시나리오고, 실무는 예외 처리가 많다. 100만 컨텍스트가 유지된다고 해도 중간 검색 정확도(retrieval precision)는 별도 검증이 필요하다. 하이쿠 3.5의 긴 컨텍스트 중후반 누락 여부는 본지가 확인하지 못했다.
한국에서 쓰려면 아직 관문 있다
국내 클라우드 마켓플레이스(NCP, KT클라우드, NHN클라우드)엔 아직 등록되지 않았다(기자 취재). 앤스로픽 콘솔에서 직접 키를 발급받아 써야 한다. 원화 결제 미지원, 세금계산서 발행 불가가 걸림돌이다. 기업 구매팀이 승인하기까진 시간이 걸린다.
무료 티어는 없다. 콘솔 가입 후 크레딧 충전부터 해야 한다. 개인 개발자라면 월 5~10달러 선에서 테스트 가능하다.
쉽게 풀어보면
앤스로픽이 클로드 하이쿠 5.5라는 새 소형 AI 모델을 발표했다. 뷔페에 비유하면 이렇다. 기존 하이쿠는 '작은 접시'에 음식을 조금만 담을 수 있었는데, 이번엔 접시 크기(컨텍스트 100만 토큰)는 그대로 두고 가격만 대폭 내렸다. 게다가 '노력 조절' 기능이 생겨, 손님(사용자)이 "이 요리는 대충 담아줘(빠르고 싸게)" 혹은 "이 요리는 정성껏 담아줘(느려도 정확하게)"를 그 자리에서 주문할 수 있게 됐다.
자료에 따르면 이전 모델 대비 around 75% lower cost다. 대량 문서 분류, 로그 분석, 간단한 코드 생성 같은 반복·대용량 작업에 쓰기 알맞다.
단, 한국 기업이 바로 쓰기엔 불편하다. 국내 클라우드 장터에 없고, 달러 결제만 된다. 무료 체험판도 없다. 개발자라면 앤스로픽 콘솔에서 직접 키를 받아 테스트해 볼 수 있다.
나에게 미치는 영향
챗GPT·클로드 웹버전 쓰는 일반인이라면 당장은 달라질 게 없다. 하이쿠 5.5는 API 전용 모델이라 웹 채팅창엔 안 뜬다. 다만 클로드 데스크톱 앱이나 커서(Cursor) 같은 코딩 도구에서 모델 선택지에 나타날 수 있다. 그때 '하이쿠 5.5 낮음/중간/높음' 옵션이 보이면 간단한 질문엔 '낮음'으로 돌려 속도와 비용을 아껴보라.
코딩 보조 도구 쓰는 개발자라면 오늘 앤스로픽 콘솔(console.anthropic.com)에서 키 발급 후 테스트해보라. thinking_budget 파라미터로 노력 단계를 바꾸면서 같은 프롬프트에서 토큰 사용량과 답변 품질이 어떻게 달라지는지 직접 측정해보라. 본인 워크플로에 맞는 기본값을 정해두면 이후 요금 폭탄을 막는다.
기업 도입 검토 중이라면 국내 클라우드 파트너사(NCP·KT·NHN) 문의부터 넣어라. 정식 등록 전까지는 직접 계약만 가능하고, 세금계산서·원화 결제·보안 심의 등 내부 절차가 걸린다. 소네트 3.5 쓰고 있던 팀이라면 비용 절감 가능성 검토해볼 만하다. 구체적 배수는 본지가 확인하지 못했다.
이전 모델과 무엇이 다른가
| 항목 | 하이쿠 3.5 | 하이쿠 5.5 |
|---|---|---|
| 입력 요금(1M 토큰) | $0.40 | $0.10 |
| 출력 요금(1M 토큰) | $1.60 | $0.40 |
| 컨텍스트 | 200K | 1M |
| 노력 조절 | 없음 | 3단계 지원 |
| OSWorld | 공개 안 됨 | 72.4% |
대용량 배치 작업에선 상위 모델 대체재가 된다. 단, 창작·추론 깊이가 필요한 태스크는 여전히 상위 모델이 앞선다.
남은 쟁점
- 한국어 토큰 효율 — 영어 기준 요금이다. 한글은 토큰당 글자 수가 적어 실제 비용이 다를 수 있다. 테스트 필수.
- 장문 컨텍스트 중후반 검색 정확도 — 100만 토큰 중 80만 이후 영역에서 정보를 찾아내는지 독립 검증 없다.
- 무료 티어·한국 리전 — 둘 다 미정. 앤스로픽 한국 지사 설립 소식도 아직 없다.
지금 쓸 사람, 기다릴 사람
지금 써볼 만하다
- 대량 로그·문서 분류·태깅 자동화하는 팀
- 코딩 에이전트에서 단순 리팩터링·테스트 생성 위임하려는 개발자
- 상위 모델 요금 부담으로 프로젝트 미뤄둔 스타트업
기다려도 된다
- 웹 채팅만 쓰는 일반 사용자
- 한국어 장문 생성·요약이 주 업무인 팀 (토큰 효율 검증 필요)
- 사내 보안·구매 프로세스 통과까지 1개월 이상 걸리는 기업
앤스로픽은 이 모델로 '작지만 실속 있는 모델' 시장을 노린다. IPO 전 라인업 확장의 일환이기도 하다. 본지가 앞서 다룬 앤스로픽 상장 위험 요인에 'AI 반감'…데이터센터 막히면 매출도 막힌다 기사에서 지적했듯, 모델 팔아 매출 내야 하는 압박이 가격 인하로 이어진 면도 있다. 사용자 입장에선 선택지가 넓어진 셈이다. 단, '싸고 빠르다'는 말에 현혹되지 말고 내 작업에 맞는 노력 단계 기본값을 찾는 데 하루쯤 써보라. 그게 진짜 절약이다.
이 기사의 출처
- r/ClaudeAIIntroducing Claude Haiku 5.5: the cheapest, fastest, and most capable small model we’ve ever released
- Anthropic 뉴스Anthropic reveals Claude Haiku 5.5, its cheapest and fastest small model yet - XDA
- Anthropic 뉴스Anthropic Introduces Claude Haiku 5.5 - TradingView
- Anthropic 뉴스Anthropic launches Claude Haiku 5.5 with tiered pricing structure - StreetInsider
- Anthropic 뉴스Anthropic unveils Claude Haiku 5.5 model - Latest news from Azerbaijan
- Anthropic 뉴스Anthropic launches third Claude 5.5 model, expanding AI lineup before planned IPO - TradingView
- Anthropic 뉴스Anthropic launches Claude Haiku 5.5 with faster responses, affordable pricing and effort controls - Firstpost
- Anthropic 뉴스Anthropic launches Claude Haiku 5.5, its most affordable and fastest model yet - Moneycontrol.com
이 글은 위 원문과 커뮤니티 반응을 바탕으로 AI의 도움을 받아 작성했으며, 발행 전 사람이 확인합니다. 사실관계는 원문 링크에서 직접 확인하실 수 있습니다.