신모델·

GPT-6 솔·루나 출시, 가격 반값인데 사용 한도는 여전하다

한 줄 요약오픈AI GPT-6 솔·루나 출시, 가격 인하했지만 사용 한도·실제 성능은 검증 필요
광고

오픈AI가 GPT-6 아스트라 발표 2주 만에 하위 모델 **솔(Sol)**과 **루나(Luna)**를 내놨다. 아스트라가 "최고 지능"이라면, 솔과 루나는 "그 지능을 더 싸고 빠르게" 쓸 수 있게 하겠다는 포지션이다. API 가격을 GPT-5.6 프로모션가 대비 50% 인하했고, 캐싱·추론 효율 개선으로 비용을 낮췄다고 설명한다.

발표 수치와 커뮤니티 체감의 간극

발표문에는 오토메이션벤치(AutomationBench), 에이전츠 라스트 엑사ム(Agents' Last Exam), 프론티어코드(FrontierCode) 같은 벤치마크가 나열돼 있다. 솔이 xhigh 노력도에서 클로드 옵서스 5를 9% 비용으로 이겼고, 루나는 전작 대비 5.4%p 향상에 비용 58% 절감했다는 식이다. 팩츄얼리티(사실성) 평가에서도 솔이 전작 대비 실수 절반으로 줄였다고 한다.

하지만 해커뉴스 댓글 273개 중 상당수는 가격표가 아니라 사용 한도를 문제 삼는다. "코덱스 20달러 체험 중 5시간 한도가 중간 규모 작업 두 번 만에 다 차서 포기했다"는 증언이 대표적. 앤트로픽 동일 요금제는 그런 경험이 없었다는 비교도 나온다. 가격이 반값이어도 시간·토큰 한도가 그대로면 실사용자는 "더 싸게 더 빨리 끊긴다"는 느낌만 받는다.

가격표 표시 방식도 혼란을 키웠다. "왼쪽에 GPT-6와 0.20달러가 먼저 나와서 이게 새 가격인 줄 알았다"는 불만이 여러 건이다. 오픈AI 개발자 문서에는 여전히 캐시 읽기 20% 비용이 별도 명시돼 있다. 발표문만 보면 50% 인하로 읽히지만, 캐시 비중이 큰 에이전트·코딩 작업에서는 실제 절감폭이 다를 수 있다.

앤트로픽 옵서스 5.5, 90분 앞선 맞불

앤트로픽은 오픈AI 발표 90분 전 클로드 옵서스 5.5를 공개했다. 옵서스 5 대비 40% 비용 절감, 기본(medium) 노력도에서 프론티어코드 54.6%로 GPT-6 아스트라 최고점 53.3%를 5분의 1 비용으로 넘겼다는 주장이다. 커서벤치(CursorBench)도 52.5%로 GPT-5.6 솔 최고치보다 11%p 높으면서 비용은 3분의 1 수준이다.

캐시 읽기 비용 60% 감소, 토큰 사용량 감소, 출력 속도 30% 향상이 맞물려 40% 절감이 나왔다고 한다. 패스트 모드는 2.5배 속도에 입력 8달러·출력 40달러(백만 토큰당) 별도 요금제다. 프로·맥스·팀·엔터프라이즈 요금제는 5시간 한도 리셋 기능을 추가했다.

흥미로운 대목은 사고 과정 비활성화 불가EU AI Act 대응 워터마킹이 기본 탑재됐다는 점. METR·프런티어 디자인 같은 외부 평가기관이 사전 검증했고, 자율 회피 시도 비율이 옵서스 5 대비 85% 줄었다는 안전성 지표도 공개했다.

광고

쉽게 풀어보면

오픈AI가 이달 초 내놓은 GPT-6 아스트라는 "지금 쓸 수 있는 가장 똑똑한 모델"로 소개됐다. 하지만 비싸고 무거워서 일상 업무엔 과하다. 그래서 루나를 내놨다. 아스트라급 지능을 더 가볍고 싸게 쓸 수 있게 포장한 셈이다.

비유하자면 아스트라는 최고급 세단, 솔은 같은 엔진 얹은 스포츠 왜건, 루나는 경량 해치백이다. 엔진(핵심 지능)은 공유하는데 차체(비용·속도·용량)를 다르게 튜닝했다.

가격은 기존 프로모션가 절반으로 내렸다. 캐시 활용과 추론 최적화로 서버 비용이 줄었으니 사용자한테도 돌리겠다는 얘기다. 벤치마크상으로는 경쟁사 최상위 모델(클로드 옵서스 5)을 비용 9~58% 수준으로 이겼다고 한다. 사실성 오류도 절반으로 줄였다고 주장한다.

그런데 실제 쓰는 사람들은 "가격보다 한도"가 문제라고 한다. 월 20달러 코덱스 체험판에서 5시간 한도가 금방 차버려 작업이 끊긴다는 경험담이 여럿이다. 가격이 싸도 중간에 끊기면 싼 게 아니다. 앤트로픽 쪽은 같은 요금제에서 그런 경험이 적었다는 비교도 나온다.

앤트로픽은 오픈AI 발표 90분 전 클로드 옵서스 5.5를 띄웠다. "옵서스 5보다 40% 싸고, 기본 설정으로 오픈AI 최상위 모델을 비용 5분의 1로 이긴다"는 반박 카드다. 사고 과정 숨기기 금지, 워터마크 기본 탑재 같은 안전 장치도 강화했다.

두 회사 모두 "우리 모델이 더 싸고 더 낫다"는 벤치마크를 내밀지만, 측정 방식·조건·낙오 비율(폴백 비용 제외 여부 등) 이 제각각이라 숫자만 놓고 비교하기엔 무리가 있다.

나에게 미치는 영향

챗GPT 유료 구독자(플러스·팀·엔터프라이즈) 라면 오늘부터 챗GPT 워크·코덱스·API에서 솔·루나를 바로 쓸 수 있다. 루나는 무료·고(Go) 사용자용 데스크톱 앱에도 순차 적용된다.

코딩·에이전트 작업을 길게 돌리는 개발자 라면 가격 인하 체감은 크지만 5시간 한도가 그대로인지 먼저 확인해야 한다. 한도 리셋 기능은 앤트로픽 쪽(프로·맥스·팀·엔터프라이즈)에만 있다. 오픈AI도 조만간 비슷한 정책을 내놓을지 모르지만, 지금은 없다.

단순 요약·번역·질의응답 위주 라면 루나(저비용·고속) 쪽이 유리하다. 무료 티어에서도 곧 쓸 수 있을 전망이니 굳이 구독 올릴 필요는 없다.

기존 구독 유지할지 갈아탈지 고민 중 이라면: 오픈AI 생태계(코덱스·워크·API)에 이미 묶여 있으면 솔·루나로 비용 절감 효과 볼 수 있다. 반면 장시간 에이전트 작업·한도 여유 가 우선이면 앤트로픽 옵서스 5.5 쪽이 당분간 유리해 보인다. 둘 다 써보고 비교하는 게 가장 빠르다 — 둘 다 API 키만 있으면 바로 테스트 가능하다.

남은 건 검증이다

오픈AI 발표문에는 캐시 읽기 20% 별도 비용, 폴백(대안 모델 호출) 비용 제외 여부, 장문 컨텍스트에서의 실지연·비용 같은 전제 조건이 생략돼 있다. 앤트로픽도 "벤치마크 격차는 점점 신뢰하기 어렵다"며 자체 실사용 격차가 더 좁다고 인정했다.

본지가 앞서 다룬 GPT-6 아스트라, 20년 풀리지 않던 에니그마 암호 해독 때도 "검증부터"라는 커뮤니티 반응이 컸다. 오픈라우터 등장 당시도 접근성·가격·검증 모두 불투명했다. 이번 솔·루나 역시 발표 수치가 실무에서 그대로 재현되는지는 아직 모른다.

지금 쓸 만한 사람: 오픈AI API·코덱스·워크를 이미 쓰고 있고, 비용 절감이 급한 팀.
기다려도 되는 사람: 무료·저가 티어에서 루나 적용 기다리는 일반 사용자, 한도 정책 개선 기다리는 헤비 유저, 제3자 독립 벤치마크 나올 때까지 판단 미루고 싶은 조직.

가격은 내렸다. 하지만 한도·안정성·실제 체감 은 아직 사용자 몫으로 남았다.

이 기사의 출처

이 글은 위 원문과 커뮤니티 반응을 바탕으로 AI의 도움을 받아 작성했으며, 발행 전 사람이 확인합니다. 사실관계는 원문 링크에서 직접 확인하실 수 있습니다.

광고