OpenAI가 7월 30일 GPT-5.6 계열의 API 가격과 처리 옵션을 조정했다. GPT-5.6 Luna는 80%, Terra는 20% 가격을 내렸고, Sol에는 같은 모델을 최대 2.5배 빠르게 실행하는 Fast mode를 추가했다. Luna와 Terra의 새 가격은 API에 즉시 적용됐다. 새 모델을 내놓은 것이 아니라, 기존 모델을 더 효율적으로 운영해 가격을 낮추고 유료 고속 처리 옵션을 추가한 것이다.[1][2]
Luna 입력 0.20달러, 출력 1.20달러
Luna의 입력 가격은 100만 토큰당 1달러에서 0.20달러로, 출력은 6달러에서 1.20달러로 내려갔다. 캐시된 입력도 0.10달러에서 0.02달러로 낮아졌다. Terra는 입력 2.50달러에서 2달러, 출력 15달러에서 12달러, 캐시된 입력 0.25달러에서 0.20달러로 조정됐다. 두 모델 모두 기존 단가에서 같은 비율로 인하됐다.[2][3][4]
GPT-5.6 API 가격 변경
| 모델 | 입력 | 캐시 입력 | 출력 | 변경 |
|---|---|---|---|---|
| Luna, 이전 | $1.00 | $0.10 | $6.00 | 기준 |
| Luna, 현재 | $0.20 | $0.02 | $1.20 | 80% 인하 |
| Terra, 이전 | $2.50 | $0.25 | $15.00 | 기준 |
| Terra, 현재 | $2.00 | $0.20 | $12.00 | 20% 인하 |
| Sol, Standard | $5.00 | $0.50 | $30.00 | 변경 없음 |
| Sol, Fast | Standard 단가의 2배 | 최대 2.5배 빠른 처리 | ||
Luna와 Terra는 텍스트와 이미지를 입력받아 텍스트를 출력하고, 105만 토큰 컨텍스트와 최대 12만8천 토큰 출력을 지원한다. 최대 입력은 92만2천 토큰이다. Luna의 API 모델 ID는 gpt-5.6-luna, Terra는 gpt-5.6-terra다. 표의 기본 가격은 짧은 컨텍스트 기준이며, 입력이 27만2천 토큰을 넘으면 해당 요청 전체의 입력 단가는 2배, 출력 단가는 1.5배가 된다. 긴 문서를 처리할 때는 80%와 20%라는 인하율만 보고 비용을 계산하면 안 된다.[3][4]
Sol은 같은 모델을 더 빨리 처리하는 Fast mode 추가
GPT-5.6 Sol의 Standard 가격은 입력 100만 토큰당 5달러, 캐시 입력 0.50달러, 출력 30달러로 유지된다. 새 Fast mode는 모델을 바꾸지 않고 같은 Sol 요청을 최대 2.5배 빠르게 처리한다. API 요청에 service_tier: "fast"를 지정하면 되며, 기존 "priority" 값도 계속 사용할 수 있다. OpenAI는 7월 30일 Priority Processing의 이름을 Fast mode로 바꿨다.[2][5][6]
Fast mode는 Standard의 2배 가격이며 별도 처리 한도를 사용한다. 한도를 넘기면 Standard로 자동 전환되지 않고 오류를 반환한다. 따라서 대화형 코딩이나 지연시간에 민감한 에이전트 작업에는 유용하지만, 단순히 모든 요청을 Fast로 보내면 처리 속도와 함께 비용도 두 배가 된다. 현재 문서상 Fast mode는 GPT-5.4와 GPT-5.6 모델에서 제공된다.[6]
Luna max 51.24점, 과제당 비용 0.057달러
OpenAI가 공개한 가격 대비 성능 차트에서 Luna max는 Artificial Analysis Intelligence Index v4.1 51.24점, 과제당 추정 비용 0.057달러였다. OpenAI는 이 차트를 비슷한 역량의 모델끼리 비교한 자료로 설명하며, Luna를 50점대 모델 가운데 과제당 비용이 낮은 모델로 제시했다.[2]
Artificial Analysis의 전체 지능 점수 비교에서는 Claude Opus 5 max가 61점, Claude Fable 5가 60점, GPT-5.6 Sol max가 59점, Luna max가 51점이다. Luna는 평가에서 출력 토큰 1억3천만 개를 생성해 비교 집단 중앙값 6천1백만 개의 두 배를 넘었다. 단가는 낮아졌지만 출력량이 많은 작업에서는 총비용을 따로 측정해야 한다.[7]
가격 인하는 모델과 서빙 최적화의 결과
OpenAI는 모델과 시스템 최적화, 프롬프트 캐시 개선, 컴퓨팅 자원 활용률 상승이 Luna와 Terra 가격 인하의 기반이라고 설명했다. Sol도 출시 이후 요청당 GPU 사용량을 20% 넘게 줄였고, 답변 품질을 유지하는 데 필요한 토큰은 약 15% 감소했다.[2]
Luna와 Terra의 새 API 가격은 이미 적용됐다. ChatGPT와 Codex 사용 조건 변경은 아직 적용되지 않았고, 이번 주 후반 반영될 예정이다.[2]