Claude Haiku 5.5를 하위 에이전트로 쓸 일과 주 모델에 둘 일

Anthropic이 2026년 10월 7일 공개한 Claude Haiku 5.5를 에이전트의 분류·추출·라우팅 같은 하위 작업에 배정할 때, Sonnet·Opus 주 모델과 나누는 기준을 공식 문서로 정리합니다.

큰 원 하나에서 가는 선으로 작은 원 여러 개가 이어지고 그중 하나가 인디고색으로 칠해진 AI Agent 블로그 표지

1. 발표 내용과 제공 상태

Anthropic이 2026년 10월 7일 Claude Haiku 5.5를 공개했습니다. 에이전트를 만드는 분이라면 주 모델 아래에서 분류·추출·라우팅처럼 반복되는 호출을 맡길 작은 모델을 새로 검토할 수 있게 됐습니다. 발표문은 이 모델이 Opus 5.5, Sonnet 5.5와 함께 코딩 작업의 하위 에이전트(subagent)로 쓰기 좋다고 소개합니다. 하위 에이전트는 주 에이전트가 작업 일부를 떼어 맡기는 별도 모델 호출을 말합니다. 이 글에서는 어떤 일을 Haiku 5.5에 넘기고 어떤 일을 Sonnet이나 Opus에 둘지 정하는 기준을 정리합니다.

Claude 개발자 문서의 모델 개요에 따르면 Haiku 5.5의 상태는 'Active (latest)'이고 베타나 프리뷰 표시는 없습니다. Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, Claude Platform on AWS에서 쓸 수 있고, Claude API에서는 모델 ID claude-haiku-5-5로 호출합니다. 지원 종료는 2027년 10월 7일 이전에는 하지 않는다고 적혀 있습니다. 요금제별 이용 제한과 지역 제한은 발표문과 문서에 적혀 있지 않아 확인하지 못했습니다. 아래 표는 문서에 적힌 가격과 용량입니다.

항목Claude Haiku 5.5 (공식 문서)
입력 가격, 프롬프트 10만 토큰 이하100만 토큰당 $0.10
입력 가격, 프롬프트 10만 토큰 초과100만 토큰당 $0.50
출력 가격, 프롬프트 10만 토큰 이하100만 토큰당 $0.50
출력 가격, 프롬프트 10만 토큰 초과100만 토큰당 $2.50
컨텍스트 창100만 토큰 (Haiku 4.5는 20만 토큰)
최대 출력128K 토큰 (Haiku 4.5는 64K 토큰)

2. 공식 문서가 하위 작업으로 꼽은 일

문서는 Haiku 5.5를 분류, 라우팅, 추출, 하위 에이전트 작업처럼 호출량이 많고 응답 속도가 중요한 일을 위해 만들었다고 설명합니다. 발표문은 Anthropic이 지금까지 낸 작은 모델 가운데 가장 싸고 빠르며 성능이 높다고 밝혔는데, 이는 회사의 주장입니다. 발표문에 실린 벤치마크 수치는 회사가 직접 측정한 값이고 독립적으로 재현됐는지 확인하지 못해 이 글에는 옮기지 않았습니다.

문서가 꼽은 일들은 결과의 모양이 미리 정해져 있다는 공통점이 있습니다. 문의를 정해 둔 분류 중 하나로 나누거나, 문서에서 날짜와 금액을 뽑아 정해진 칸에 채우거나, 요청을 어느 도구로 보낼지 고르는 일은 결과가 형식에 맞는지 코드로 바로 검사할 수 있습니다. 작성자는 이 검사 가능 여부를 하위 작업으로 넘길지 정하는 첫 기준으로 봅니다. 결과를 코드로 검사할 수 있으면 작은 모델이 가끔 틀려도 다시 호출하거나 주 모델로 넘기는 경로를 만들어 둘 수 있기 때문입니다.

3. 하위 작업으로 넘길지 정하는 질문 순서

아래 도식은 작업 하나를 Haiku 5.5에 넘길지 정할 때 작성자가 권하는 질문 순서를 예시로 그린 것입니다. 결과 형식이 정해져 있는지, 코드로 검사할 수 있는지, 프롬프트가 10만 토큰 안에 들어가는지, 공격 기법이 필요한 보안 작업인지를 차례로 묻습니다. 앞의 2개 질문에서 아니오가 나오면 Sonnet 5.5나 Opus 5.5에 둡니다.

예시로 코딩 에이전트를 생각해 보겠습니다. 주 모델인 Sonnet 5.5가 수정 계획을 세우고, 실패한 테스트 로그 수십 건을 환경 문제, 코드 결함, 불안정한 테스트 중 하나로 분류하는 일은 Haiku 5.5 하위 에이전트에 맡깁니다. 분류 결과를 받아 어느 파일부터 고칠지 정하고 코드를 바꾸는 일은 다시 Sonnet 5.5가 합니다. 로그 분류는 반복이 많고 결과 형식이 정해져 있지만, 수정 순서와 코드 변경은 답이 열려 있어 결과를 코드로 판정하기 어렵습니다.

주 에이전트가 떼어 낸 작업 1건이 결과 형식, 코드 검사 가능 여부, 10만 토큰 이하 여부, 공격 기법 필요 여부 질문을 차례로 거쳐 Haiku 5.5 하위 에이전트 또는 Sonnet·Opus 주 모델, 맥락 줄이기, 거절 처리 경로로 나뉘는 분기 도식
작성자가 구성한 판단 순서 예시입니다. 10만 토큰 가격 구간과 보안 안전장치 내용은 Anthropic 발표문과 Claude 개발자 문서의 사실이고, 질문의 순서와 배정 결과는 작성자 해석입니다. 이미지를 열어 확대할 수 있습니다. 화면이 좁으면 도식을 가로로 스크롤해 글자를 확인하세요.

4. 100만 토큰 창과 10만 토큰 가격 구간

Haiku 5.5의 컨텍스트 창은 100만 토큰으로 Haiku 4.5의 20만 토큰보다 크게 늘었습니다. 그런데 가격은 프롬프트 길이 10만 토큰을 기준으로 바뀝니다. 10만 토큰을 넘는 프롬프트는 100만 토큰당 입력 가격이 $0.10에서 $0.50으로, 출력 가격이 $0.50에서 $2.50으로 5배가 됩니다.

작성자 판단으로는 하위 에이전트에 맥락을 통째로 넘기는 설계를 피하는 편이 좋습니다. 주 에이전트가 대화 기록 전체나 저장소 전체를 넘기면 창에는 들어가더라도 높은 가격 구간으로 넘어가기 쉽습니다. 하위 작업에는 그 작업에 필요한 문서 조각과 출력 형식만 넘기고, 큰 맥락을 읽어야 하는 일은 넘기기 전에 나눌 수 있는지부터 확인합니다.

발표문은 Haiku 5.5가 Haiku 계열 처음으로 조절 가능한 노력(effort) 설정을 갖췄다고 밝혔습니다. 단순한 분류와 조금 더 복잡한 추출에 다른 설정을 줄 수 있다는 뜻으로 읽히지만, 설정 단계와 단계별 비용·속도 차이는 이번에 확인한 자료에 적혀 있지 않습니다. 실제 값은 작은 표본으로 직접 측정해 정하는 편이 안전합니다.

5. 주 모델이나 별도 절차에 둘 일

작성자는 작업 계획을 세우는 일, 하위 작업 결과를 모아 최종 판단을 내리는 일, 사용자에게 보낼 최종 답변을 쓰는 일은 Sonnet 5.5나 Opus 5.5에 두기를 권합니다. 이런 일은 결과 형식이 열려 있어 맞고 틀림을 코드로 판정하기 어렵고, 틀렸을 때 다음 단계 전체에 영향을 줍니다. Sonnet 5.5와 Opus 5.5의 가격은 이번에 확인한 자료에 없어 비용 비교는 하지 않았습니다.

보안 작업은 따로 봐야 합니다. 발표문에 따르면 Haiku 5.5의 사이버보안 안전장치는 Haiku 4.5보다 엄격하고, 다른 최근 모델보다는 다소 느슨하지만 침투 테스트처럼 공격자가 쓸 가능성이 큰 기법은 여전히 막습니다. 다른 최근 모델의 안전장치가 더 엄격하다고 적혀 있으므로 주 모델로 옮긴다고 해결되는 일도 아닙니다. 보안 점검 하위 에이전트를 계획한다면 요청이 거절됐을 때 사람이 넘겨받는 경로를 먼저 정해 두어야 합니다.

6. 이번 주에 해 볼 일

운영 중인 에이전트 하나를 골라, 실행 기록에서 주 모델이 직접 처리한 분류·추출·라우팅 호출을 찾아 보십시오. 그중 결과를 코드로 검사할 수 있는 작업 1건을 claude-haiku-5-5로 바꾸고, 같은 입력 50건 정도로 기존 결과와의 일치율, 응답 시간, 프롬프트가 10만 토큰을 넘은 호출 수를 기록합니다. 모델 ID는 코드에 직접 적지 말고 설정값으로 빼 두면 다음 모델이 나왔을 때도 같은 측정을 그대로 반복할 수 있습니다.

확인한 공식 출처

  1. Introducing Claude Haiku 5.5 (Anthropic, 2026년 10월 7일)
  2. Claude Haiku 5.5 모델 개요 (Claude 개발자 문서, 2026년 10월 7일 출시 표기)
  3. What's new in Claude Haiku 5.5 (Claude 개발자 문서)