테크부터 경제, 생활까지. 복잡한 소식을 쉽게 풀어봅니다.
안녕하세요! 오늘은 “AI 값”이 확 내려간 소식이에요. 클로드를 만드는 앤트로픽이 미국 시간 10월 7일 ‘클로드 하이쿠 5.5(Claude Haiku 5.5)’를 공개했습니다. 앤트로픽은 이 모델을 “지금까지 내놓은 소형 모델 중 가장 싸고, 가장 빠르고, 가장 똑똑한 모델”이라고 소개했어요.
가격표를 보면 눈이 동그래집니다. 짧은 요청 기준으로 이전 모델보다 90% 저렴해졌거든요. “토큰”이 뭔지부터, 이게 왜 우리 생활과도 관련이 있는지 쉽게 풀어 볼게요.

한 줄로 먼저
- 하이쿠 5.5는 클로드 5.5 가족 중 가장 작고 빠른 막내예요. 요약, 분류, 데이터 조회, 실시간 고객 상담처럼 짧고 양이 많은 일에 맞춰졌습니다.
- 개발자용 가격은 100만 토큰당 입력 0.1달러, 출력 0.5달러(요청 10만 토큰 이하). 이전 하이쿠 4.5(1달러·5달러)의 10분의 1이에요.
- 일반 이용자도 클로드 앱·웹(무료·프로·맥스·팀·엔터프라이즈)에서 모델을 하이쿠 5.5로 골라 쓸 수 있습니다.
먼저 용어부터
| 용어 | 쉬운 뜻 | 비유 |
|---|---|---|
| 토큰 | AI가 글을 읽고 쓰는 최소 조각. AI 요금은 토큰 수로 매겨요 | 택시 요금의 “미터기 칸” |
| 입력·출력 토큰 | AI에게 보낸 글(입력)과 AI가 쓴 답(출력) | 보낸 문자 / 받은 답장 |
| 소형 모델 | 덩치를 줄여 빠르고 싸게 만든 AI | 경차: 연비 좋고 날렵함 |
| 캐시(cache) | 자주 쓰는 내용을 저장해 다시 읽을 때 싸게 처리 | 자주 가는 길을 내비가 기억 |
| 서브에이전트 | 큰 AI 밑에서 잔일을 나눠 맡는 작은 AI | 팀장 밑의 손 빠른 팀원 |
| 노력(effort) 설정 | 더 깊게 생각할지, 더 싸고 빠르게 할지 고르는 손잡이 | 에어컨 강·약 조절 |
얼마나 싸졌나: 가격표 비교

| 100만 토큰당 (달러) | 하이쿠 5.5 (10만 토큰 이하 / 초과) |
하이쿠 4.5 | 소네트 5.5 |
|---|---|---|---|
| 입력 | 0.10 / 0.50 | 1.00 | 2.00 |
| 출력 | 0.50 / 2.50 | 5.00 | 10.00 |
| 캐시 읽기 | 0.01 / 0.05 | 0.10 | 0.10 |
| 캐시 쓰기 | 0.125 / 0.625 | 1.25 | 2.50 |
앤트로픽 공식 발표 기준입니다. 요청 길이가 10만 토큰 이하일 때 90% 저렴, 초과할 때는 50% 저렴해요. 배치(모아서 처리) 요청은 추가로 50% 할인됩니다.
앤트로픽에 따르면 이전 하이쿠 요청의 약 90%가 10만 토큰 이하였다고 해요. 다만 새 모델은 글을 조금 더 잘게 쪼개는 방식(토크나이저)을 써서 같은 일에 토큰이 약간 더 듭니다. 이것까지 계산하면 평균적으로 약 75% 저렴하게 돌릴 수 있다는 게 회사 설명이에요.
싼데 실력은? 시험 성적 비교

| 시험(무엇을 보나) | 하이쿠 5.5 | 하이쿠 4.5 | GPT-6 루나 | 소네트 5.5(상위 모델) |
|---|---|---|---|---|
| OSWorld 2.1 (컴퓨터 직접 조작) | 72.4% | 15.7% | 48.9% | 83.9% |
| Terminal-Bench 4.0 (명령창 코딩) | 39.2% | 0.0% | 16.4% | 70.6% |
| 인류의 마지막 시험 HLE (도구 없이) | 45.9% | 10.2% | – | 56.9% |
| GDPval-AA v2.1 (실무 지식 작업, 점수) | 1620 | 735 | 1437 | 1840 |
| Chartography (도표 읽기, 도구 없이) | 46.4% | 6.4% | 29.1% | 61.6% |
앤트로픽이 발표 자료에서 공개한 수치이며, “-”는 공개되지 않은 칸입니다. OSWorld는 오프라인 세트 기준이에요.
정리하면 하이쿠 5.5는 형님 모델인 소네트 5.5에는 못 미치지만, 이전 하이쿠보다 크게 좋아졌고 경쟁 소형 모델인 오픈AI GPT-6 루나보다 높은 점수를 받았어요. 앤트로픽도 복잡한 코딩은 여전히 소네트·오퍼스가 낫고, 하이쿠는 범위가 좁고 반복적인 일에 맞는다고 선을 그었습니다.
어디에 쓰면 좋을까?

| 이런 일에 | 왜 하이쿠 5.5? |
|---|---|
| 긴 문서 요약, 대화 압축 | 짧고 많은 작업이라 싼 값이 그대로 이득 |
| 문의 분류·태그 달기 | 빠른 응답 속도가 중요 |
| 실시간 고객 상담 챗봇 | 앤트로픽 설명상 “가장 빠른 모델” |
| 브라우저·컴퓨터 대신 조작 | OSWorld 점수가 크게 오름 |
| 큰 모델의 보조 일꾼(서브에이전트) | 큰 모델이 지휘하고 하이쿠가 자료를 빠르게 찾아옴 |
실제 기업 반응도 나왔어요
발표 자료에 실린 초기 고객 후기에 따르면, 아사나는 작업 완료 지연이 30% 넘게 줄었다고 했고, 박스(Box)는 하이쿠 4.5보다 11점 높은 점수를 약 절반의 지연 시간으로 얻었다고 밝혔어요. 다만 회사가 고른 후기라는 점은 감안해서 보면 좋습니다.
함께 바뀐 것들
| 변경 사항 | 내용 |
|---|---|
| 소네트 5.5 캐시 할인 | 캐시 읽기 가격 100만 토큰당 0.20달러 → 0.10달러(50% 인하). 대부분의 에이전트 작업이 약 20% 저렴해진다고 설명 |
| 월간 API 크레딧 | 이번 주부터 맥스 5x 월 100달러, 맥스 20x 월 200달러, 팀 요금제 최대 500달러(팀원 공유) |
| 노력 설정 | 하이쿠 계열 처음으로 “노력(effort)” 조절 기능 탑재 |
| 쓸 수 있는 곳 | 클로드 앱·웹, 클로드 API(claude-haiku-5-5), AWS, 구글 클라우드, 마이크로소프트 애저 |
나에게는 무슨 의미일까?
- 일반 이용자: 클로드 앱에서 간단한 질문·요약은 하이쿠 5.5를 골라 쓰면 답이 더 빨리 나와요.
- 앱·서비스를 만드는 분: 챗봇·요약 기능의 운영비가 크게 줄 수 있습니다. 같은 예산으로 더 많은 요청을 처리할 수 있죠.
- 장기적으로: AI 원가가 내려가면 우리가 쓰는 쇼핑몰 상담, 번역, 고객센터 같은 서비스에 AI가 더 넓게 들어올 가능성이 커져요.
“싸고 빠른 AI” 경쟁은 오픈AI의 GPT-6 루나와 같은 가격대에서 맞붙는 모양새예요. 가격 경쟁이 치열해질수록 이용자에게는 좋은 소식이겠죠? 다음에도 어려운 AI 소식, 쉽게 풀어 드릴게요!