
안녕하세요, 미니지식공간입니다.
gpt-6.1-sol이 2026년 9월 29일 DevDay 2026에서 공개됐다. GPT-6.1 Sol 가격은 100만 토큰당 입력 2달러·출력 10달러로 직전 모델과 같지만, 캐시 입력이 절반이 되고 상위 모델 GPT-6 Astra 대비 정확히 5분의 1 단가라는 점이 이번 릴리스의 실질이다.
TL;DR
- 모델 ID
gpt-6.1-sol, 컨텍스트 1,050,000 토큰 / 최대 출력 128,000 토큰 / 지식 컷오프 2026-04-30.- 표시 단가 2달러/10달러는
gpt-6-sol과 동일. 캐시 입력만 0.20달러 → 0.10달러.gpt-6-astra(10달러/50달러) 대비 입력·출력 모두 정확히 1/5. 성능 비교는 전부 OpenAI 자사 발표.
공식 모델 문서에 적힌 값은 다음과 같다. 컨텍스트 윈도(한 요청에 넣을 수 있는 입력 토큰 최대치)는 1,050,000 토큰으로 gpt-6-sol과 같고, 최대 출력도 128,000 토큰으로 동일하다. 달라진 것은 지식 컷오프로, gpt-6-sol의 2026-04-20에서 2026-04-30으로 열흘 밀렸다. 입력 모달리티는 텍스트·이미지, 출력은 텍스트다.
레이트 리밋은 등급에 따라 나뉜다. Tier 1이 분당 500회 요청 / 분당 50만 토큰, Tier 5가 분당 15,000회 요청 / 분당 4,000만 토큰이다. 대량 배치를 계획한다면 단가보다 이 값이 먼저 병목이 된다.
| 항목 (per 1M tokens) | gpt-6.1-sol | gpt-6-sol | gpt-6-astra |
|---|---|---|---|
| 입력 | $2.00 | $2.00 | $10.00 |
| 캐시 입력 | $0.10 | $0.20 | $1.00 |
| 출력 | $10.00 | $10.00 | $50.00 |
| 입력(긴 컨텍스트) | $4.00 | 문서 미확인 | $20.00 |
| 캐시 입력(긴 컨텍스트) | $0.20 | 문서 미확인 | $2.00 |
| 출력(긴 컨텍스트) | $15.00 | 문서 미확인 | $75.00 |
출처: https://developers.openai.com/api/docs/pricing (2026-09-30 조회)
표에서 실제로 내려간 칸은 캐시 입력 하나다. 공식 소개 페이지도 이 값을 "기본 입력가 대비 95% 저렴, gpt-6-sol의 캐시 가격 대비 50% 인하"라고 설명한다. 즉 프롬프트 캐싱을 쓰지 않는 호출 패턴이라면 이번 릴리스로 줄어드는 비용은 0이다.
Astra 대비 5분의 1이라는 표현은 표의 첫 열과 마지막 열을 나눈 값 그대로다. 입력 10달러 대 2달러, 출력 50달러 대 10달러, 긴 컨텍스트에서도 20달러 대 4달러, 75달러 대 15달러로 비율이 유지된다. 다만 긴 컨텍스트 구간으로 넘어가는 토큰 경계값은 이번에 조회한 공식 문서 범위에서 확인되지 않았다(확인 필요).
공식 Text generation 가이드의 Responses API 예제를 그대로 가져오고, model 값만 문서에 기재된 모델 ID로 교체한 형태다. 문서에 없는 파라미터는 추가하지 않았다.
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-6.1-sol",
reasoning={"effort": "low"},
instructions="Talk like a pirate.",
input="Are semicolons optional in JavaScript?",
)
print(response.output_text)
import OpenAI from "openai";
const client = new OpenAI();
const response = await client.responses.create({
model: "gpt-6.1-sol",
reasoning: { effort: "low" },
instructions: "Talk like a pirate.",
input: "Are semicolons optional in JavaScript?",
});
console.log(response.output_text);
예제 원본 출처: https://developers.openai.com/api/docs/guides/text
모델 ID 출처: https://developers.openai.com/api/docs/models/gpt-6.1-sol

model: gpt-6.1-sol
context window: 1,050,000 tokens (input)
max output: 128,000 tokens
knowledge cutoff: 2026-04-30
modalities: input = text, image / output = text
reasoning_effort: low | medium (default) | high | xhigh | max
tools: web search, file search, image generation,
code interpreter, hosted shell, apply patch,
skills, computer use, MCP, tool search
endpoints: Responses, Chat Completions, Realtime,
Live sessions, Assistants, Batch, Fine-tuning
rate limit: Tier 1 = 500 RPM / 500K TPM
Tier 5 = 15,000 RPM / 40M TPM
출처: https://developers.openai.com/api/docs/models/gpt-6.1-sol
노력 수준 값 체계는 gpt-6-sol과 같은 다섯 단계이고 기본값도 medium이다. 그러나 같은 effort 값이라도 모델이 바뀌면 실제 생성되는 추론 토큰 수가 달라질 수 있다. 표시 단가가 같다고 해서 청구액이 같다는 보장은 없으므로, 교체 후에는 요청당 토큰 수를 며칠 관찰하는 편이 안전하다.
| 평가 | OpenAI 발표 결과 |
|---|---|
| DeepSWE v1.1 | gpt-6-astra와 동급, gpt-6-sol 대비 +6.4%p |
| AutomationBench | 동일 설정에서 gpt-6-sol 대비 +4.8%p |
| OSWorld 2.0 | 최대 노력에서 gpt-6-sol 대비 +7%p, 비용은 절반 이하 |
| Terminal-Bench Science | gpt-6-sol 점수의 2배 이상, 과제당 $5.47 (경쟁 모델 $23.21~$23.80) |
| 사실성 평가 | low 노력에서 오류율 11.4% → 7.7% |
전부 OpenAI 자사 발표 수치이며 독립 검증 결과가 아니다. "Astra와 동급"은 DeepSWE v1.1 한 평가에 한정된 서술이고, Terminal-Bench Science의 비교군 모델명은 공식 페이지에서 구체적으로 명시되지 않았다. DevDay 요약 페이지는 이를 "표준 입력·출력 토큰 가격의 5분의 1로 Astra에 가까운 지능"이라고 정리했다.
속도 축에는 별도 등급이 있다. Ultrafast는 Codex에서 최대 8배(초당 약 300토큰), API에서 최대 6배 빠른 토큰 생성을 제공한다고 발표됐다. 다만 공식 가격 문서에 올라온 Ultrafast 단가는 gpt-6-astra(입력 $60 / 캐시 $6 / 출력 $300)뿐이고, gpt-6.1-sol의 Ultrafast 단가는 아직 표에 없다(확인 필요). 소개 페이지는 Sol의 Ultrafast 버전이 "며칠 안에" 제공된다고만 적었다.
effort 값을 그대로 두더라도 요청당 추론 토큰이 달라질 수 있다. 교체 전후 평균 토큰 수를 비교한다.gpt-6.1-sol로 바꾸면 API 요금이 줄어드나?
표시 단가는 gpt-6-sol과 같으므로 기본 호출만으로는 줄지 않는다. 캐시 입력이 100만 토큰당 $0.20에서 $0.10으로 내렸으므로, 프롬프트 캐싱을 쓰는 구성에서만 요금이 감소한다.
기존 코드 수정이 필요한가?
이번에 확인한 공식 문서 범위에서는 model 문자열 교체 외에 필수 변경 사항이 안내되지 않았다. 지원 엔드포인트와 reasoning_effort 허용값도 동일하다. 다만 노력 수준별 토큰 소비는 재측정을 권한다.
gpt-6.1-sol Ultrafast는 지금 쓸 수 있나?
소개 페이지 기준으로 Sol의 Ultrafast 버전은 며칠 안에 제공 예정이며, 공식 가격 문서에는 아직 단가가 올라와 있지 않다. 현재 Ultrafast 단가가 공개된 모델은 gpt-6-astra뿐이다.
정리하면 이번 릴리스는 단가 인하가 아니라 "같은 가격에 더 나은 모델"이라는 형태입니다. 실무에서 먼저 손대야 할 곳은 모델 문자열과 캐시 설정 두 군데입니다. 같은 벤더의 직전 단가 구조는 GPT-6 Sol·Luna vs Claude Opus 5.5 API 단가 비교 글에 정리해 두었으니 함께 보시면 비교가 쉽습니다.
본 글은 공개 자료를 바탕으로 정리했으며, 세부 내용·수치는 원 출처·공식 문서와 대조 확인을 권장합니다. 성능·비용 비교 수치는 모두 OpenAI 자사 발표이며 독립 검증 결과가 아닙니다.