AI 값이 10분의 1로 내려갔다? 앤트로픽 ‘클로드 하이쿠 5.5’를 초보도 쉽게

테크부터 경제, 생활까지. 복잡한 소식을 쉽게 풀어봅니다.

안녕하세요! 오늘은 “AI 값”이 확 내려간 소식이에요. 클로드를 만드는 앤트로픽이 미국 시간 10월 7일 ‘클로드 하이쿠 5.5(Claude Haiku 5.5)’를 공개했습니다. 앤트로픽은 이 모델을 “지금까지 내놓은 소형 모델 중 가장 싸고, 가장 빠르고, 가장 똑똑한 모델”이라고 소개했어요.

가격표를 보면 눈이 동그래집니다. 짧은 요청 기준으로 이전 모델보다 90% 저렴해졌거든요. “토큰”이 뭔지부터, 이게 왜 우리 생활과도 관련이 있는지 쉽게 풀어 볼게요.

앤트로픽이 '가장 싸고 가장 빠른' 소형 모델이라고 소개한 클로드 하이쿠 5.5
앤트로픽이 ‘가장 싸고 가장 빠른’ 소형 모델이라고 소개한 클로드 하이쿠 5.5

한 줄로 먼저

  • 하이쿠 5.5는 클로드 5.5 가족 중 가장 작고 빠른 막내예요. 요약, 분류, 데이터 조회, 실시간 고객 상담처럼 짧고 양이 많은 일에 맞춰졌습니다.
  • 개발자용 가격은 100만 토큰당 입력 0.1달러, 출력 0.5달러(요청 10만 토큰 이하). 이전 하이쿠 4.5(1달러·5달러)의 10분의 1이에요.
  • 일반 이용자도 클로드 앱·웹(무료·프로·맥스·팀·엔터프라이즈)에서 모델을 하이쿠 5.5로 골라 쓸 수 있습니다.

먼저 용어부터

용어 쉬운 뜻 비유
토큰 AI가 글을 읽고 쓰는 최소 조각. AI 요금은 토큰 수로 매겨요 택시 요금의 “미터기 칸”
입력·출력 토큰 AI에게 보낸 글(입력)과 AI가 쓴 답(출력) 보낸 문자 / 받은 답장
소형 모델 덩치를 줄여 빠르고 싸게 만든 AI 경차: 연비 좋고 날렵함
캐시(cache) 자주 쓰는 내용을 저장해 다시 읽을 때 싸게 처리 자주 가는 길을 내비가 기억
서브에이전트 큰 AI 밑에서 잔일을 나눠 맡는 작은 AI 팀장 밑의 손 빠른 팀원
노력(effort) 설정 더 깊게 생각할지, 더 싸고 빠르게 할지 고르는 손잡이 에어컨 강·약 조절

얼마나 싸졌나: 가격표 비교

100만 토큰당 가격(프롬프트 10만 토큰 이하): 하이쿠 4.5 입력 1달러·출력 5달러, 하이쿠 5.5 입력 0.1달러·출력 0.5달러, 소네트 5.5 입력 2달러·출력 10달러
100만 토큰당 가격(프롬프트 10만 토큰 이하): 하이쿠 4.5 입력 1달러·출력 5달러, 하이쿠 5.5 입력 0.1달러·출력 0.5달러, 소네트 5.5 입력 2달러·출력 10달러
100만 토큰당 (달러) 하이쿠 5.5
(10만 토큰 이하 / 초과)
하이쿠 4.5 소네트 5.5
입력 0.10 / 0.50 1.00 2.00
출력 0.50 / 2.50 5.00 10.00
캐시 읽기 0.01 / 0.05 0.10 0.10
캐시 쓰기 0.125 / 0.625 1.25 2.50

앤트로픽 공식 발표 기준입니다. 요청 길이가 10만 토큰 이하일 때 90% 저렴, 초과할 때는 50% 저렴해요. 배치(모아서 처리) 요청은 추가로 50% 할인됩니다.

앤트로픽에 따르면 이전 하이쿠 요청의 약 90%가 10만 토큰 이하였다고 해요. 다만 새 모델은 글을 조금 더 잘게 쪼개는 방식(토크나이저)을 써서 같은 일에 토큰이 약간 더 듭니다. 이것까지 계산하면 평균적으로 약 75% 저렴하게 돌릴 수 있다는 게 회사 설명이에요.

싼데 실력은? 시험 성적 비교

앤트로픽 공개 수치 기준 OSWorld 2.1(오프라인 세트) 점수: 하이쿠 4.5 15.7%, GPT-6 루나 48.9%, 하이쿠 5.5 72.4%, 소네트 5.5 83.9%
앤트로픽 공개 수치 기준 OSWorld 2.1(오프라인 세트) 점수: 하이쿠 4.5 15.7%, GPT-6 루나 48.9%, 하이쿠 5.5 72.4%, 소네트 5.5 83.9%
시험(무엇을 보나) 하이쿠 5.5 하이쿠 4.5 GPT-6 루나 소네트 5.5(상위 모델)
OSWorld 2.1 (컴퓨터 직접 조작) 72.4% 15.7% 48.9% 83.9%
Terminal-Bench 4.0 (명령창 코딩) 39.2% 0.0% 16.4% 70.6%
인류의 마지막 시험 HLE (도구 없이) 45.9% 10.2% – 56.9%
GDPval-AA v2.1 (실무 지식 작업, 점수) 1620 735 1437 1840
Chartography (도표 읽기, 도구 없이) 46.4% 6.4% 29.1% 61.6%

앤트로픽이 발표 자료에서 공개한 수치이며, “-”는 공개되지 않은 칸입니다. OSWorld는 오프라인 세트 기준이에요.

정리하면 하이쿠 5.5는 형님 모델인 소네트 5.5에는 못 미치지만, 이전 하이쿠보다 크게 좋아졌고 경쟁 소형 모델인 오픈AI GPT-6 루나보다 높은 점수를 받았어요. 앤트로픽도 복잡한 코딩은 여전히 소네트·오퍼스가 낫고, 하이쿠는 범위가 좁고 반복적인 일에 맞는다고 선을 그었습니다.

어디에 쓰면 좋을까?

큰 모델이 전체 일을 지휘하고, 하이쿠 5.5는 요약·분류·자료 찾기·고객 응대처럼 짧고 많은 일을 빠르게 맡는 구조
큰 모델이 전체 일을 지휘하고, 하이쿠 5.5는 요약·분류·자료 찾기·고객 응대처럼 짧고 많은 일을 빠르게 맡는 구조
이런 일에 왜 하이쿠 5.5?
긴 문서 요약, 대화 압축 짧고 많은 작업이라 싼 값이 그대로 이득
문의 분류·태그 달기 빠른 응답 속도가 중요
실시간 고객 상담 챗봇 앤트로픽 설명상 “가장 빠른 모델”
브라우저·컴퓨터 대신 조작 OSWorld 점수가 크게 오름
큰 모델의 보조 일꾼(서브에이전트) 큰 모델이 지휘하고 하이쿠가 자료를 빠르게 찾아옴

실제 기업 반응도 나왔어요
발표 자료에 실린 초기 고객 후기에 따르면, 아사나는 작업 완료 지연이 30% 넘게 줄었다고 했고, 박스(Box)는 하이쿠 4.5보다 11점 높은 점수를 약 절반의 지연 시간으로 얻었다고 밝혔어요. 다만 회사가 고른 후기라는 점은 감안해서 보면 좋습니다.

함께 바뀐 것들

변경 사항 내용
소네트 5.5 캐시 할인 캐시 읽기 가격 100만 토큰당 0.20달러 → 0.10달러(50% 인하). 대부분의 에이전트 작업이 약 20% 저렴해진다고 설명
월간 API 크레딧 이번 주부터 맥스 5x 월 100달러, 맥스 20x 월 200달러, 팀 요금제 최대 500달러(팀원 공유)
노력 설정 하이쿠 계열 처음으로 “노력(effort)” 조절 기능 탑재
쓸 수 있는 곳 클로드 앱·웹, 클로드 API(claude-haiku-5-5), AWS, 구글 클라우드, 마이크로소프트 애저

나에게는 무슨 의미일까?

  • 일반 이용자: 클로드 앱에서 간단한 질문·요약은 하이쿠 5.5를 골라 쓰면 답이 더 빨리 나와요.
  • 앱·서비스를 만드는 분: 챗봇·요약 기능의 운영비가 크게 줄 수 있습니다. 같은 예산으로 더 많은 요청을 처리할 수 있죠.
  • 장기적으로: AI 원가가 내려가면 우리가 쓰는 쇼핑몰 상담, 번역, 고객센터 같은 서비스에 AI가 더 넓게 들어올 가능성이 커져요.

“싸고 빠른 AI” 경쟁은 오픈AI의 GPT-6 루나와 같은 가격대에서 맞붙는 모양새예요. 가격 경쟁이 치열해질수록 이용자에게는 좋은 소식이겠죠? 다음에도 어려운 AI 소식, 쉽게 풀어 드릴게요!

답글 남기기

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다