LLM 가성비 지도 매일 갱신… 내 예산에 맞는 모델 한눈에
개발자 테리 디조니가 만든 웹사이트 '베스트 모델 포 유어 버짓'이 해커뉴스에서 148점, 댓글 97개를 얻으며 화제다. 이 사이트는 인공지능 분석(AI Analysis) 지수와 블렌디드 API 가격을 로그 스케일로 교차해 **'가성비 프론티어'**라 부르는 선을 그린다. 프론티어 위에 있는 모델은 '그 가격에 이보다 똑똑한 모델이 없다'는 뜻이다.
데이터는 인공지능 분석의 무료 API를 깃허브 액션 크론으로 매일 긁어온다. 코드와 원본 데이터는 깃허브(terryds/bestvaluemodel)에 공개돼 있다. 모델명 클릭 시 상세 페이지로 연결되고, 열 헤더 클릭으로 정렬도 된다. 신규·삭제·재평가·재가격 모델을 일일 차분으로 보여주는 점도 특징이다.
쉽게 풀어보면
이 사이트는 **'예산별로 오늘 살 수 있는 가장 똑똑한 모델'**을 보여주는 지도다. 뷔페에 비유하자면, 가격대별로 '이 접시가 영양가 대비 최고'라는 표시를 붙여둔 셈이다. 사용자는 표에서 자기 예산 행을 찾으면 된다. 100만 토큰당 블렌디드 비용(입력 3: 출력 1 비율)을 가로축, 지능 지수를 세로축에 뒀다.
예를 들어 100만 토큰당 0.50달러 이하라면 그 구간 1등 모델이 '픽'으로, 2등이 '러너업'으로 뜬다. 비싼 모델이 무조건 좋은 게 아니라, 돈 대비 성능이 가장 좋은 지점만 골라준다는 게 핵심이다. 한국어로 된 설명은 없지만, 숫자와 모델명만 보면 누구나 읽을 수 있다.
한국에서 바로 쓸 수 있을까
사이트 접속 자체는 차단되지 않는다. 한국어 인터페이스는 없고 영어로만 제공된다. 가격 단위가 달러고, API 기준이라 일반 사용자가 쓰는 챗GPT 플러스(월 20달러)나 클로드 프로(월 20달러) 같은 구독제와는 단위가 다르다. 해커뉴스 댓글에서도 "토큰제는 월정액보다 비싸게 나온다"는 지적이 많았다.
국내에서 API를 직접 쓰는 개발자나 스타트업이라면 이 표가 유용하다. 하지만 일반 사용자는 구독제 요금제와 비교해봐야 실질적인 가성비가 보인다. 본지가 앞서 다룬 퀸 3.8 플래시 넥스트(퀸 3.8 플래시 넥스트 공개… 125B MoE가 6B만 깨워 쓴다)처럼 오픈모델을 로컬로 돌리면 API 비용 자체가 안 든다는 대안도 있다.
데이터가 말하지 않는 것들
사이트는 '블렌디드 가격'만 보여준다. 입력·출력 비율을 3:1로 고정한 평균값이라, **출력 비중이 높은 작업(코드 생성, 장문 요약)**이면 실제 비용이 더 들 수 있다. 또 지능 지수는 인공지능 분석의 벤치마크 종합점수인데, 한국어 능력이나 코딩 특화 성능은 별도 지표다.
모델별 최신 버전만 표시하고 저득점 모델은 기본 숨김 처리돼 있다. 필터를 풀면 전체가 나오지만, 구형 저가 모델이 의외로 가성비 좋을 수 있다는 점을 놓치기 쉽다. 일일 차분 기능은 편하지만, 가격 변동이 하루 사이에 크지 않은 모델이 대부분이라 매일 확인할 필요성은 낮아 보인다.
커뮤니티가 짚은 빈틈
해커뉴스 댓글에서 가장 많이 나온 요청은 **"로컬 AI 버전도 만들어달라"**는 것이다. 가로축을 VRAM(비디오 메모리)으로 바꿔 '내 그래픽카드에서 돌릴 수 있는 최고 모델'을 보여달라는 뜻이다. 또 제트브레인 주니($30/월, 크레딧 $35 포함) 같은 IDE 내장 에이전트 구독제가 토큰제보다 싸다는 경험담도 여럿 보였다.
"용도에 따라 최적 모델이 다르다"는 지적도 핵심이다. 코딩·비전·텍스트 분석·컴퓨터 사용 중 뭘 주로 하느냐에 따라 프론티어 위 모델이라도 체감 성능이 갈린다. 프론티어는 '종합 지수' 기준이라 특정 작업 특화 모델은 프론티어 아래에 있어도 더 나을 수 있다.
나에게 미치는 영향
오늘 할 수 있는 행동 세 가지다.
- 사이트(bestmodelforyourbudget.terrydjony.com)에 접속해 내 API 예산 행을 찾아 모델명만 메모해두기. 한국어 벤치마크는 별도 확인 필요.
- 챗GPT·클로드·제미나이 월 20달러 구독을 쓰고 있다면 토큰제 API로 갈아타기 전 이번 달 사용량부터 확인하기. 대부분 구독제가 더 싸다.
- 로컬 실행 가능한 GPU가 있다면 올라마(Ollama)나 라마.cpp로 퀸·라마 계열 소형 모델을 먼저 테스트하기. API 비용 제로에서 시작한다.
남은 쟁점
이 도구는 '가격 대비 종합 지수'라는 단일 척도로 복잡한 선택을 단순화했다. 편하지만, 한국어 성능·컨텍스트 길이·툴 사용 능력·라이선스까지 고려하려면 결국 직접 테스트해야 한다. 사이트 제작자도 "필터를 풀어 전체를 보라"고 권한다. 본지가 다룬 제브(타입세이프 '제브' 등장… 텍스트 넣고 숫자만 받는 결정 모델)처럼 특수 목적 모델은 프론티어 밖에 있어도 쓰임새가 있다.
한국 사용자 입장에서 가장 현실적인 가성비는 여전히 월 2만 원대 구독제다. API 토큰제로 같은 성능을 내려면 사용량을 아주 낮게 잡아야 맞는다. 이 지도를 '참고용 지도'로 쓰고, 실제 요금제는 내 쓰임새에 맞춰 계산하는 게 정답이다.
이 기사의 출처
- Hacker NewsBest LLM for every budget, updated daily
이 글은 위 원문과 커뮤니티 반응을 바탕으로 AI의 도움을 받아 작성했으며, 발행 전 사람이 확인합니다. 사실관계는 원문 링크에서 직접 확인하실 수 있습니다.