GPT-6 Sol·Luna vs Claude Opus 5.5 — API 단가와 캐시 요율을 공식 문서로 비교하기

mini_knows·2026년 9월 23일

AI 트렌드·이슈

목록 보기
110/119

안녕하세요, 미니지식공간입니다. 2026년 9월 22일 GPT-6 Sol과 Claude Opus 5.5가 몇 시간 간격으로 공개되면서 LLM API 단가표가 하루 만에 바뀌었다. 이 글은 두 발표를 공식 가격 문서와 API 문서 기준으로 나란히 놓고, 토큰 단가·캐시 요율·모델 문자열 관점에서만 정리한다.

  • claude-opus-5-5: 입력 $4 / 출력 $20 per MTok. Opus 5($5/$25) 대비 표시 단가 20% 인하, 캐시 읽기는 $0.50 → $0.20으로 60% 인하.
  • gpt-6-sol: $2/$10, gpt-6-luna: $0.10/$0.50. 직전 GPT-5.6 Sol($4/$20) 대비 입력·출력 모두 정확히 50% 인하.
  • 성능 수치는 전부 각 회사 자사 발표. 독립 검증 결과는 공개되지 않았다.

1. 단가표: 같은 축으로 놓고 보기

두 회사의 공식 문서를 그대로 옮긴 MTok(100만 토큰)당 단가다. GPT-6 계열 단가는 입력 272K 토큰 이하 프롬프트 기준이다.

모델 ID입력캐시 읽기출력직전 세대
claude-opus-5-5$4$0.20$20Opus 5: $5 / $0.50 / $25
claude-fable-5-1$10$0.25$50–
gpt-6-sol$2$0.20$10GPT-5.6 Sol: $4 / – / $20
gpt-6-luna$0.10$0.01$0.50GPT-5.6 Luna: $0.20 / – / $1.20
gpt-6-astra$10$1.00$50–

출력 단가만 보면 gpt-6-sol이 claude-opus-5-5의 절반이다. 다만 두 모델은 같은 급으로 포지셔닝된 적이 없으므로, 단가 비교는 "어느 쪽이 싸다"가 아니라 자신의 워크로드에서 과제당 토큰 소모가 어떻게 다른지를 재기 위한 출발점으로만 쓰는 편이 맞다.

2. 이번 인하의 실질은 캐시 요율에 있다

Anthropic이 공개 자료에서 밝힌 "기본 설정 기준 약 40% 비용 감소"는 표시 단가 인하만으로는 나오지 않는다. 공식 가격 문서 기준 claude-opus-5-5의 캐시 읽기 배수는 기본 입력의 0.05배($0.20)이고, 이는 Fable 5.1·Mythos 5.1의 0.025배와 함께 별도 특례 요율로 문서에 명시돼 있다. 표시 단가 20% 인하 + 캐시 읽기 60% 인하가 합쳐진 값으로 읽어야 한다.

OpenAI 쪽도 구조는 같다. gpt-6-sol의 캐시 입력은 $0.20으로 기본 입력 $2의 10분의 1, gpt-6-luna는 $0.01로 $0.10의 10분의 1이다. 결국 프롬프트 프리픽스를 얼마나 안정적으로 유지하느냐가 실효 단가를 가른다. 배치 처리까지 쓰면 claude-opus-5-5는 입력 $2 / 출력 $10으로 다시 절반이 된다.

구간claude-opus-5-5gpt-6-sol
기본 입력$4$2
캐시 읽기$0.20 (0.05x)$0.20 (0.1x)
5분 캐시 쓰기$5 (1.25x)문서 미확인
출력$20$10
배치$2 / $10문서 미확인

gpt-6-sol의 캐시 쓰기·배치 요율은 이번에 확인한 문서 범위에서 명시를 찾지 못했다. 확인 필요 항목으로 둔다.

3. 모델 문자열 교체

두 발표 모두 신규 모델 추가이므로 기존 호출이 깨지는 변경은 아니다. 아래 스니펫은 각 공식 문서의 예제와 파라미터 표기를 그대로 옮긴 것이고, 모델 문자열만 이번에 공개된 ID로 바꿨다.

Anthropic Messages API — 공식 예제 구조 그대로, 모델 ID만 claude-opus-5-5로 교체했다. 모델 ID와 컨텍스트(1M 토큰)·최대 출력(128K)은 모델 개요 문서 기준이다.

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-opus-5-5",
    "max_tokens": 1024,
    "messages": [
      {"role": "user", "content": "Hello, Claude"}
    ]
  }'

출처: https://platform.claude.com/docs/en/api/messages / https://platform.claude.com/docs/en/about-claude/models/overview

OpenAI 쪽은 changelog가 지원 엔드포인트와 입력 양식을 명시한다. 문서에 기재된 항목만 정리한 스니펫이다.

model:      gpt-6-sol | gpt-6-luna
endpoints:  POST /v1/responses
            POST /v1/chat/completions
input:      text, image
output:     text
pricing:    gpt-6-sol   $2.00 in / $0.20 cached in / $10.00 out  (per 1M tokens)
            gpt-6-luna  $0.10 in / $0.01 cached in / $0.50 out   (per 1M tokens)
note:       위 단가는 입력 272K 토큰 이하 프롬프트 기준

출처: https://developers.openai.com/api/docs/changelog (2026-09-22 항목)

4. 벤치마크: 전부 자사 발표

주체벤치마크수치
AnthropicTerminal-Bench 4.066.4%
AnthropicFrontierCode v1.154.4%
AnthropicCursorBench 4.057.8% (비교군 GPT-5.6 Sol 41.7%)
AnthropicCoBench 2.1 (내부)55.8%
OpenAIAutomationBench 1.0.6 (Sol, xhigh)33.2% / 과제당 $0.27
OpenAIDeepSWE v1.1 (Sol, max)68.8%
OpenAIOSWorld 2.0 (Sol, xhigh)60.5%

두 회사가 강조한 문장 구조가 거의 같다는 점이 눈에 띈다. Anthropic은 Opus 5.5가 더 큰 Fable 5.1과 견줄 수준이라고 했고, OpenAI는 Sol이 DeepSWE v1.1·OSWorld 2.0에서 과제당 비용을 약 80% 낮췄다고 했다. 서로 다른 설정·측정 조건의 값이므로 교차 비교는 성립하지 않는다.

5. 전환 전에 점검할 것

  1. 캐시 프리픽스 고정 여부. 시스템 프롬프트와 고정 문서를 앞쪽에 몰고, 요청마다 바뀌는 값은 뒤로 미룬다. 캐시 적중률이 실효 단가를 가장 크게 움직인다.
  2. 272K 토큰 경계. GPT-6 계열의 위 단가는 이 구간 이하 기준이다. 장문 컨텍스트를 상시로 밀어 넣는 파이프라인이라면 초과 시 요율을 먼저 확인해야 한다.
  3. 경량 라인 대기. Anthropic은 Sonnet 5.5와 Haiku 5.5를 "앞으로 몇 주 안에" 공개하겠다고 밝혔다. 라우팅 계층이 있다면 중간·경량 모델이 정리된 뒤 한 번에 옮기는 편이 재작업이 적다.
  4. 사용 한도 서술 불일치. Anthropic의 5시간 사용 한도 변경은 출처에 따라 "상향"과 "폐지"로 엇갈린다. 확인 필요 항목이며 공식 플랜 문서를 직접 확인해야 한다.

자주 묻는 질문

Q. gpt-6-sol과 claude-opus-5-5 중 어느 쪽이 싼가?
표시 단가만 보면 gpt-6-sol이 입력·출력 모두 절반이다. 다만 과제당 실제 비용은 모델이 소모하는 토큰 수에 좌우되므로, 자신의 평가 세트로 토큰 소모량과 청구액을 함께 측정해 보는 것이 맞다.

Q. 기존 API 코드를 수정해야 하나?
두 건 모두 신규 모델 추가라 기존 호출이 곧바로 깨지지는 않는다. 새 모델을 쓰려면 모델 문자열만 바꾸면 되지만, 공개 첫날 기준이므로 파라미터 지원 범위는 공식 문서에서 확인하는 편이 안전하다.

Q. 캐시 읽기 단가는 어떻게 적용되나?
claude-opus-5-5는 기본 입력의 0.05배($0.20/MTok), gpt-6-sol·gpt-6-luna는 기본 입력의 10분의 1이 적용된다. 프롬프트 앞부분이 동일하게 유지될 때만 적중하므로, 매 요청 앞머리에 타임스탬프 같은 가변 값을 넣으면 적중률이 떨어진다.

마무리

정리하면 2026년 9월 22일 하루에 claude-opus-5-5는 표시 단가 20%, gpt-6-sol·gpt-6-luna는 50% 수준의 인하가 각각 발표됐다. 지금 당장 모델을 갈아타기보다, 캐시 적중률과 과제당 토큰 소모를 먼저 측정해 두면 경량 라인이 나왔을 때 판단이 빨라진다. GPT-6 계열의 기반이 된 Astra의 API 변경점은 GPT-6 Astra API 마이그레이션 정리에 따로 정리해 뒀다.

출처

본 글은 공개 자료를 바탕으로 정리했으며, 세부 내용·수치는 원 출처·공식 문서와 대조 확인을 권장합니다. 본문의 성능 수치는 전부 각 회사의 자사 발표이며 독립 검증 결과가 아닙니다.

profile
작지만 알아야 할 모든 것

0개의 댓글