3줄 요약

  • 10월 7일 출시된 Haiku 5.5는 Anthropic의 Max effort 비교에서 GPT-6 Luna보다 컴퓨터 작업과 명령줄 작업 점수가 크게 높았음
  • API 기본 단가가 같은 건 프롬프트 10만 토큰까지라, 성적이 높다고 실제 작업 비용까지 싸다고 볼 수는 없음
  • 나는 Codex $100 플랜을 Plus로 내리고 Claude $100 Max를 쓸 예정이며, OpenAI의 조만간 신모델 발표는 아직 내 예상임

Claude 막내가 Luna와 격차를 꽤 벌렸음

출시 비교에 나온 평가 Haiku 5.5 GPT-6 Luna 격차
OSWorld 2.1 오프라인 컴퓨터 작업, 부분 점수 72.4% 48.9% +23.5%p
Terminal-Bench 4.0 명령줄 작업 39.2% 16.4% +22.8%p
FrontierCode 1.1 Main, 코드 변경의 수용 가능성 46.4% 42.4% +4.0%p

출처: Anthropic 출시 표와 시스템 카드 8.3·8.4·8.9.3절; Max effort, 2026년 10월 8일 확인

  • OSWorld의 72.4%는 중간 단계까지 반영한 부분 점수이며, 모든 단계를 완벽히 끝낸 작업의 비율은 아님
  • 컴퓨터 작업은 Anthropic이 Luna도 같은 오프라인 과제로 돌렸고, 명령줄 점수는 Claude Code와 다른 Codex 환경의 공개 순위표에서 가져옴
  • 작업 환경이 다른 공개 평가이며, 같은 돈을 쓰게 맞춘 시험이나 내가 직접 돌린 Haiku 실험은 아님

같은 가격은 10만 토큰까지만임

프롬프트 길이 구간에 따라 Haiku와 Luna의 입력·출력 100만 토큰당 API 요금을 구분한 도표

HSL 제작 — Haiku 요금, OpenAI Luna 문서; 100만 토큰당 USD, 일반 처리 기준, 2026년 10월 8일 확인

  • 프롬프트 10만 토큰까지는 둘 다 100만 토큰당 입력 $0.10·출력 $0.50임
  • Haiku는 10만 토큰을 넘으면 요청 전체의 단가가 5배로 올라가고, Luna의 할증은 입력 27만 2천 토큰을 넘을 때 시작됨
  • 그림은 캐시·도구·처리 옵션 할증을 제외한 것이며, API 비용과 구독 사용량도 별개임
  • 토큰을 더 쓰거나 재시도가 늘면 시작 단가가 같아도 작업 하나당 비용은 올라갈 수 있음
  • 짧은 작업은 Haiku를 시험해볼 만하고, 긴 세션은 실제 사용량도 봐야겠음

속도 조절해도 경쟁사 성적표는 신경 쓰일 듯

Max effort 기준 주요 Claude·OpenAI 모델의 AA 지능지수와 Opus·Sonnet의 기본 대체 모델 적용 조건을 표시한 차트

출처: Artificial Analysis, 2026년 10월 8일 확인; 반올림한 Max 지수 점수이며 Opus·Sonnet은 기본 대체 모델 적용, HSL 제작 차트로 동일 비용 비교는 아님

  • Fable–Astra의 최상위 경쟁을 빼고 내가 매일 쓸 모델들을 고르면, 지금은 전반적으로 Claude 우위라는 생각임
  • 위 지수도 그 판단에 힘을 보태지만, 지수 하나로 모든 작업에서 이긴다고 확정할 수는 없음
  • Anthropic은 속도 조절을 요구한 뒤 첫 출시가 Opus 5.5라고 설명했고, Sonnet에 이어 Haiku까지 내놨음
  • OpenAI도 9월 29일 GPT-6.1 Sol을 내놓는 등 새 제품을 계속 출시하고 있음
  • 그래도 지금 같은 성능 경쟁은 의식할 수밖에 없을 것 같고, 조만간 새 모델 소식이 나와도 놀랍지는 않겠음
  • 내 예상이며, 확인한 자료에서 후속 Luna의 출시일이 확정된 건 아님
  • 다음 발표회를 기다리는 동안에도 구독자는 결제할 곳을 바꿀 수 있음

내 100달러는 Claude 쪽으로 옮길 예정임

현재 제시한 Codex 월 100달러와 계획 중인 Plus 20달러·Claude Max 100달러 조합을 비교한 구독 예산 그림

HSL 제작 — 내 계획과 OpenAI 월 요금, Claude 월 요금, 2026년 10월 8일 확인; 제시한 구독만 계산했으며 적용 세금·추가 사용료는 제외

  • Codex $100 플랜을 쓰던 나는 Plus로 내리고 Claude의 $100 Max 옵션을 쓸 예정임
  • 제시한 조합은 $20 + $100 = 월 $120이라, 절약이 아니라 $20를 더 쓰는 선택임
  • 이전 Sol·Opus·Sonnet 글에서는 작업 환경은 Codex가 좋고 지능은 Opus가 더 마음에 든다고 적었음
  • Astra·Opus 비교 글에서도 완성된 결과물 때문에 Opus 쪽으로 선택이 기울었음
  • Codex는 Plus로 남겨두고, 주력 구독에 돈을 더 낼 곳을 바꾸려는 것임
  • 실제로 받아들일 만한 결과와 수정 횟수, 쓸 수 있는 한도를 보고 이 선택을 판단하겠음

커뮤니티 반응

  • 발표 스레드의 한 이용자는 Haiku 출시를 KO 한 방 같은 움직임이라고 반겼음 (Reddit)
  • r/opencode의 한 이용자는 비교표를 믿기 전에 Luna의 추론 설정부터 알려 달라고 했음 (Reddit)
  • 답글에서는 Luna를 소프트웨어 개발 업무에 하루 종일 잘 쓰고 있다는 의견도 나왔음 (Reddit)
  • Codex 이용자는 Haiku에 대응할 Luna 6.1을 요청했으며, 출시 소식이 아니라 희망을 적은 글임 (Reddit)

Q&A 또 궁금한 것은?

  • Q. Haiku가 GPT-6.1 Sol도 이겼음?
    • 위 AA 결과에서는 Haiku Max 43점, Sol Max 52점이라 Luna 비교를 그 주장으로 확대할 수는 없음
  • Q. Max가 평소 기본 설정임?
    • Haiku API의 기본값은 Medium이고, 시스템 카드에서도 effort에 따라 결과가 크게 달라짐
  • Q. Haiku를 써보려면 $100 플랜이 필요함?
    • Anthropic은 무료 이용자에게도 Haiku를 제공한다고 안내하며, 내 Max 계획은 한도를 포함한 전체 Claude 작업을 위한 선택임
  • Q. 이걸로 OpenAI가 사업 위기라고 확정할 수 있음?
    • 성능 경쟁의 압박과 내 구독 선택을 보여주는 것이며, 회사 전체 매출이나 구독자 이탈률을 확인한 건 아님