앤스로픽, 클로드 웹·데스크톱 3배 빠르게 — AI가 스스로 병목 찾아 고쳤다
2주 만에 3배, 숫자 뒤에 있는 것
앤스로픽이 8월 진행한 2주 스프린트 결과, 클로드.ai 신규 로딩(75백분위)은 3.1초에서 0.55초로, 새 클로드 코드 세션 시작은 0.8초에서 0.3초로, 카우워크 클라우드 세션 로딩은 2.6초에서 0.73초로 줄었다. 이 네 가지 여정이 전체 사용자 활동의 95%를 차지한다. 하루 수만 시간의 대기시간이 사라진 셈이다.
재미있는 건 누가 고쳤느냐다. 내부 연구 모델 '클로드 태그'(오퍼스 5.5급)가 병목을 찾아내고, 벤치마크를 짜고, 수정안을 배포하고, 배포 후 회귀까지 감시했다. 사람은 목표를 주고, 트레이드오프를 승인하고, 최종 변경만 허가했다. 그 결과 3000건 넘는 변경이 단 한 건의 고객 장애·롤백 없이 병합됐다.
쉽게 풀어보면
앤스로픽이 클로드 웹사이트와 데스크톱 앱을 3배 빠르게 만들었습니다. 전체 사용자 중 75%가 겪던 로딩 시간을 기준으로 삼았습니다. 100명 중 75번째로 느린 사람도 3초 넘게 기다리던 게 0.5초대로 들어왔다는 뜻입니다.
뷔페에 비유하면 이렇습니다. 이전에는 손님이 들어와서 음식을 담으려 할 때마다 주방에서 새 접시를 꺼내오고, 음식을 새로 데우고, 식탁까지 나르는 과정이 매번 처음부터 반복됐습니다. 이제는 자주 쓰는 접시와 음식을 미리 식탁 위에 올려두고(정적 컴포저 HTML 내장), 손님이 메뉴를 쳐다만 봐도 음식을 데워두며(호버 시 프리페치), 불필요한 왕복(사이드바 리렌더 90% 감소)을 없앴습니다.
이 작업을 사람이 일일이 하지 않았습니다. 클로드 태그라는 내부 AI 모델이 '성능 매니저' 역할을 맡아 슬랙 채널에서 24시간 돌았습니다. 데이터독 MCP 서버로 사용자 행동 데이터를 읽어 병목을 찾고, 밸그린드(Valgrind) 같은 도구로 자바스크립트 명령어 수까지 세며 개선 효과를 수치로 증명했습니다. 사람이 잠든 사이에도 AI가 프로토타입을 짜고, 검증하고, 배포 후보를 올리면 아침에 사람이 승인만 하는 식이었습니다.
어떻게 측정했나 — 벽시계 대신 '명령어 수'
벽시계 시간은 네트워크 지터, GC 타이밍, 다른 프로세스 간섭으로 매번 다릅니다. 앤스로픽은 결정론적 지표를 골랐습니다.
- 순수 자바스크립트 핫패스:
node --predictable로 밸그린드 돌리며 명령어 수(Ir) 비교. 한 번 실행으로 통계 없이 차이 확인 - 브라우저/리액트 경로: 리액트 커밋 횟수, V8 정밀 커버리지의 함수 호출 수, 레이아웃·스타일 재계산 횟수, DOM 뮤테이션 수
이 지표들을 슬랙 스레드별로 병렬 실행해 11분 만에 5개 측정 스레드를 띄웠습니다. '측정 가능한 것'만 목표로 삼고, 측정이 불가능한 건 측정 가능하게 만드는 쪽에 투입한 전략이 주효했습니다.
한국 사용자가 지금 확인할 수 있는 것
클로드.ai는 한국에서 별도 우회 없이 접속됩니다. 한국어도 공식 지원합니다. 데스크톱 앱(macOS/Windows)도 공식 사이트에서 무료 다운로드 가능합니다. 요금제는 무료·프로(월 20달러)·팀(월 30달러/인) 그대로며, 이번 속도 개선은 모든 요금제에 동일 적용됩니다.
당장 해볼 만한 확인법:
- 클로드.ai 새 탭에서 로딩 체감 — 첫 입력 가능까지 0.5초대면 성공
- 데스크톱 앱에서 새 대화 시작 — 0.3초 내 컴포저 활성화되는지
- 기존 대화 이어가기 — 사이드바 클릭 시 리렌더 지연 사라졌는지
무료 플랜도 하루 메시지 한도 외에 속도 제한은 없습니다. 기존에 쓰던 챗GPT 플러스나 제미나이 어드밴스드와 병행해도 비용 추가 없이 비교 가능합니다.
커뮤니티가 짚은 허점들
해커뉴스 댓글 76개 중 눈에 띄는 지적 세 가지.
- "클로드가 내 파이썬 스크립트 다 망가뜨렸다" — 실제 프로덕션 코드 리팩토링 능력에 회의적 시각 존재
- "클로드하트의 법칙: 지표를 목표로 삼으면 AI가 그 지표를 게임한다" — 명령어 수·리액트 커밋 수 같은 프록시 지표를 최적화하다 실제 UX와 멀어질 수 있다는 경고
- "'유저 저니'란 말부터 짜증 난다, 그냥 빨리 결과 줘" — 마케팅 용어 남발에 대한 반감
앤스로픽도 블로그에서 **"완전 자율은 아직 불가능하다, 사람이 목표·승인·트레이드오프를 쥐고 있다"**고 명시했습니다. 지표 게임 위험을 사람이 막고 있다는 뜻입니다.
과거 연결 — 본지가 본 '측정 자동화' 흐름
작년 11월 본지 기사 '클로드, 브라우저 조작으로 웹 테스트 자동화'에서 앤스로픽이 MCP(Model Context Protocol)로 외부 도구를 호출하게 한 시도를 다뤘습니다. 당시만 해도 '측정 도구를 AI가 직접 돌린다'는 수준이었습니다. 이번 스프린트는 그 연장선상에서 AI가 측정 → 분석 → 수정 → 배포 → 감시까지 루프를 돌게 한 첫 실증입니다. 사람 개입이 '승인'만 남은 점이 다릅니다.
남은 쟁점 — 측정 자체가 비용이다
밸그린드 돌리고 V8 커버리지 수집하고 리액트 커밋 세는 건 CI 시간이 길어지고 인프라 비용이 듭니다. 앤스로픽은 내부 모델로 이 비용을 감당했지만, 일반 팀이 똑같이 하려면 측정 파이프라인 구축부터가 진입 장벽입니다.
또 '3배 빨라졌다'는 75백분위 기준입니다. 중간값(50백분위)은 더 낮을 수 있고, 99백분위(꼬리 지연)는 별도 언급이 없습니다. 한국망에서 해저케이블 지연이 끼면 체감 개선폭은 다를 수 있습니다.
나에게 미치는 영향
오늘 바로 클로드.ai 새 탭을 열어보세요. 로딩이 눈에 띄게 빠르면 이번 스프린트 효과를 그대로 누리는 겁니다. 데스크톱 앱을 안 쓰고 있었다면 공식 사이트에서 받아 설치만 하면 됩니다. 별도 설정 없이 바로 빨라진 버전입니다.
만약 답변 품질이 아쉽다면 같은 질문을 새 대화창에서 다시 던져보세요. 컨텍스트가 깨끗할 때 더 빠르고 정확한 경우가 많습니다. 이건 속도 개선과 별개로 챗봇 공통으로 통하는 팁입니다.
무료 플랜으로도 하루 수십 회 대화는 충분합니다. 프로 구독 중이라면 클로드 코드(개발자 도구) 세션 시작 0.3초를 직접 느껴보세요. IDE 플러그인 없이 웹에서 바로 코드 실행·수정 루프가 돕니다.
본문 인용 수치 출처: 앤스로픽 공식 블로그 'How we made claude.ai 3x faster in two weeks' (claude.dev/blog/how-we-made-claude-ai-faster). 커뮤니티 반응 출처: 해커뉴스 토론 스레드(id: 49821196).
이 기사의 출처
이 글은 위 원문과 커뮤니티 반응을 바탕으로 AI의 도움을 받아 작성했으며, 발행 전 사람이 확인합니다. 사실관계는 원문 링크에서 직접 확인하실 수 있습니다.