3줄 요약
- 10월 7일 출시된 Haiku 5.5는 Anthropic의 Max effort 비교에서 GPT-6 Luna보다 컴퓨터 작업과 명령줄 작업 점수가 크게 높았음
- API 기본 단가가 같은 건 프롬프트 10만 토큰까지라, 성적이 높다고 실제 작업 비용까지 싸다고 볼 수는 없음
- 나는 Codex $100 플랜을 Plus로 내리고 Claude $100 Max를 쓸 예정이며, OpenAI의 조만간 신모델 발표는 아직 내 예상임
Claude 막내가 Luna와 격차를 꽤 벌렸음
- Haiku 5.5는 Claude·Claude Code·API에서 제공되며, effort 설정으로 성능과 비용을 조절할 수 있음
| 출시 비교에 나온 평가 | Haiku 5.5 | GPT-6 Luna | 격차 |
|---|---|---|---|
| OSWorld 2.1 오프라인 컴퓨터 작업, 부분 점수 | 72.4% | 48.9% | +23.5%p |
| Terminal-Bench 4.0 명령줄 작업 | 39.2% | 16.4% | +22.8%p |
| FrontierCode 1.1 Main, 코드 변경의 수용 가능성 | 46.4% | 42.4% | +4.0%p |
출처: Anthropic 출시 표와 시스템 카드 8.3·8.4·8.9.3절; Max effort, 2026년 10월 8일 확인
- OSWorld의 72.4%는 중간 단계까지 반영한 부분 점수이며, 모든 단계를 완벽히 끝낸 작업의 비율은 아님
- 컴퓨터 작업은 Anthropic이 Luna도 같은 오프라인 과제로 돌렸고, 명령줄 점수는 Claude Code와 다른 Codex 환경의 공개 순위표에서 가져옴
- 작업 환경이 다른 공개 평가이며, 같은 돈을 쓰게 맞춘 시험이나 내가 직접 돌린 Haiku 실험은 아님
같은 가격은 10만 토큰까지만임

HSL 제작 — Haiku 요금, OpenAI Luna 문서; 100만 토큰당 USD, 일반 처리 기준, 2026년 10월 8일 확인
- 프롬프트 10만 토큰까지는 둘 다 100만 토큰당 입력 $0.10·출력 $0.50임
- Haiku는 10만 토큰을 넘으면 요청 전체의 단가가 5배로 올라가고, Luna의 할증은 입력 27만 2천 토큰을 넘을 때 시작됨
- 그림은 캐시·도구·처리 옵션 할증을 제외한 것이며, API 비용과 구독 사용량도 별개임
- 토큰을 더 쓰거나 재시도가 늘면 시작 단가가 같아도 작업 하나당 비용은 올라갈 수 있음
- 짧은 작업은 Haiku를 시험해볼 만하고, 긴 세션은 실제 사용량도 봐야겠음
속도 조절해도 경쟁사 성적표는 신경 쓰일 듯

출처: Artificial Analysis, 2026년 10월 8일 확인; 반올림한 Max 지수 점수이며 Opus·Sonnet은 기본 대체 모델 적용, HSL 제작 차트로 동일 비용 비교는 아님
- Fable–Astra의 최상위 경쟁을 빼고 내가 매일 쓸 모델들을 고르면, 지금은 전반적으로 Claude 우위라는 생각임
- 위 지수도 그 판단에 힘을 보태지만, 지수 하나로 모든 작업에서 이긴다고 확정할 수는 없음
- Anthropic은 속도 조절을 요구한 뒤 첫 출시가 Opus 5.5라고 설명했고, Sonnet에 이어 Haiku까지 내놨음
- OpenAI도 9월 29일 GPT-6.1 Sol을 내놓는 등 새 제품을 계속 출시하고 있음
- 그래도 지금 같은 성능 경쟁은 의식할 수밖에 없을 것 같고, 조만간 새 모델 소식이 나와도 놀랍지는 않겠음
- 내 예상이며, 확인한 자료에서 후속 Luna의 출시일이 확정된 건 아님
- 다음 발표회를 기다리는 동안에도 구독자는 결제할 곳을 바꿀 수 있음
내 100달러는 Claude 쪽으로 옮길 예정임

HSL 제작 — 내 계획과 OpenAI 월 요금, Claude 월 요금, 2026년 10월 8일 확인; 제시한 구독만 계산했으며 적용 세금·추가 사용료는 제외
- Codex $100 플랜을 쓰던 나는 Plus로 내리고 Claude의 $100 Max 옵션을 쓸 예정임
- 제시한 조합은 $20 + $100 = 월 $120이라, 절약이 아니라 $20를 더 쓰는 선택임
- 이전 Sol·Opus·Sonnet 글에서는 작업 환경은 Codex가 좋고 지능은 Opus가 더 마음에 든다고 적었음
- Astra·Opus 비교 글에서도 완성된 결과물 때문에 Opus 쪽으로 선택이 기울었음
- Codex는 Plus로 남겨두고, 주력 구독에 돈을 더 낼 곳을 바꾸려는 것임
- 실제로 받아들일 만한 결과와 수정 횟수, 쓸 수 있는 한도를 보고 이 선택을 판단하겠음
커뮤니티 반응
- 발표 스레드의 한 이용자는 Haiku 출시를 KO 한 방 같은 움직임이라고 반겼음 (Reddit)
- r/opencode의 한 이용자는 비교표를 믿기 전에 Luna의 추론 설정부터 알려 달라고 했음 (Reddit)
- 답글에서는 Luna를 소프트웨어 개발 업무에 하루 종일 잘 쓰고 있다는 의견도 나왔음 (Reddit)
- Codex 이용자는 Haiku에 대응할 Luna 6.1을 요청했으며, 출시 소식이 아니라 희망을 적은 글임 (Reddit)
Q&A 또 궁금한 것은?
- Q. Haiku가 GPT-6.1 Sol도 이겼음?
- 위 AA 결과에서는 Haiku Max 43점, Sol Max 52점이라 Luna 비교를 그 주장으로 확대할 수는 없음
- Q. Max가 평소 기본 설정임?
- Haiku API의 기본값은 Medium이고, 시스템 카드에서도 effort에 따라 결과가 크게 달라짐
- Q. Haiku를 써보려면 $100 플랜이 필요함?
- Anthropic은 무료 이용자에게도 Haiku를 제공한다고 안내하며, 내 Max 계획은 한도를 포함한 전체 Claude 작업을 위한 선택임
- Q. 이걸로 OpenAI가 사업 위기라고 확정할 수 있음?
- 성능 경쟁의 압박과 내 구독 선택을 보여주는 것이며, 회사 전체 매출이나 구독자 이탈률을 확인한 건 아님
