앤트로픽(Anthropic)이 이전 하이쿠 모델보다 평균 운영비를 75% 낮춘 소형 AI 모델 클로드 하이쿠 5.5(Claude Haiku 5.5)를 출시했다. 앤트로픽은 10월 8일 공식 블로그에서 이 모델이 지금까지 내놓은 하이쿠 모델 중 가장 빠르고 성능이 뛰어나다고 소개했다.
비용 민감한 반복 업무 겨냥
클로드 하이쿠 5.5는 요약, 대화 기록 압축, 데이터베이스 질의, 분류처럼 대량으로 빠르게 처리해야 하는 작업을 겨냥했다. 앤트로픽은 비용에 민감한 작업에서 반복적으로 안정적인 처리를 할 수 있도록 설계했다고 설명했다. 빠른 응답이 중요한 실시간 고객 지원이나 브라우저 이용에도 적합하다는 설명이다.
코딩 작업에서는 클로드 오푸스 5.5(Opus 5.5)와 클로드 소넷 5.5(Claude Sonnet 5.5)의 하위 에이전트로 활용할 수 있다. 앤트로픽은 클로드 하이쿠 5.5가 자사 모델 가운데 가장 빠르다고 밝혔지만, 발표 내용에는 응답 속도나 처리량의 절대 수치가 따로 제시되지 않았다. 이전 모델인 하이쿠 4.5와 비교하면 실행 비용은 평균 약 75% 낮아졌다.
노력 설정과 이용료 조정
새 모델은 하이쿠 계열 중 처음으로 ‘노력 설정’을 제공한다. 이용자는 이 설정을 조절해 비용 절감과 답변의 지능·성능 가운데 어느 쪽을 우선할지 선택할 수 있다. 앤트로픽은 설정별 성능을 OS월드(OSWorld) 2.1, 아티피셜 애널리시스(Artificial Analysis)의 GDPval-AA v2.1, 휴머니티스 라스트 이그잼(Humanity’s Last Exam) 등 세 평가 기준으로 살펴봤다고 밝혔다. OS월드는 실제 컴퓨터에서 여러 단계를 거치는 작업을 수행하는 에이전트 능력을, GDPval은 44개 직업의 실제 전문 업무 수행을 평가한다. 휴머니티스 라스트 이그잼은 전문가 수준의 학술 지식과 추론을 측정한다.
이번 발표에는 하이쿠 5.5 출시와 함께 다른 이용료 조정도 포함됐다. 클로드 소넷 5.5의 캐시 읽기 가격을 절반으로 낮춰 에이전트형(agentic) 작업 대부분에서 실행 비용이 약 20% 줄어들도록 했다. 클로드 맥스와 팀 구독자에게는 클로드 플랫폼에서 에이전트와 애플리케이션을 개발할 수 있도록 월간 API 크레딧도 제공한다. 다만 발표 내용에는 크레딧의 액수나 세부 지급 조건이 명시되지 않았다.
앤트로픽은 초기 테스트에 참여한 고객들이 성능과 비용 개선을 확인했다고 전했다. 한 고객은 AI 팀원 제품의 버그 분류, 프로젝트 설정, 대규모 포트폴리오 검색 등을 평가한 결과, 기존 모델보다 작업 완료 지연 시간이 30% 넘게 줄었고 에이전트 한 차례 처리 속도는 최대 2.5배 빨라졌다고 밝혔다. 해당 고객의 신원과 평가 환경의 세부 수치는 공개되지 않았다. 앤트로픽은 하이쿠 5.5의 구체적인 가격표 대신 이전 모델 대비 평균 비용 절감 폭과 소넷 모델의 가격 조정을 제시했다.