GPT-6 Sol·Luna 출시: API 요금 50% 인하와 쓸 수 있는 곳

GPT-6 Sol Luna · 1분 핵심 체크

  • GPT-6 Sol은 복잡한 코딩·에이전트 작업, GPT-6 Luna는 분류·추출처럼 반복량이 많은 작업에 맞춘 모델입니다.
  • 표준 단문 요금은 100만 토큰당 Sol 입력 2달러·출력 10달러, Luna 입력 0.10달러·출력 0.50달러입니다.
  • ChatGPT Work와 Codex, OpenAI API에서 사용할 수 있지만 일반 Chat 대화창에는 아직 제공되지 않습니다.
  • 장문 입력, Fast 모드, 지역 처리, 도구 호출을 사용하면 표에 보이는 기본 단가보다 실제 청구액이 커질 수 있습니다.
하나의 AI 기반에서 복잡한 작업용 대형 연산 장치와 대량 반복 작업용 소형 연산 장치가 나뉘어 작동하는 모습
GPT-6 Sol은 복잡한 코딩과 에이전트 작업, GPT-6 Luna는 비용을 줄여야 하는 대량 반복 작업에 맞춰 선택할 수 있습니다.

GPT-6 Sol과 GPT-6 Luna가 2026년 9월 22일 공개됐습니다. 이름만 보면 기존 모델의 작은 버전처럼 보이지만 역할은 뚜렷합니다. Sol은 복잡한 코딩과 여러 도구를 이어 쓰는 작업, Luna는 분류·요약·정보 추출처럼 같은 일을 많이 반복하는 작업에 맞습니다.

가장 먼저 기억할 것은 ‘50% 인하’가 모든 상황에서 청구액이 정확히 절반이 된다는 뜻은 아니라는 점입니다. 기본 토큰 단가는 크게 낮아졌지만 입력 길이, 캐시 사용량, 처리 방식과 도구 호출에 따라 실제 비용은 달라집니다.

기본 요금은 Sol 2달러·10달러, Luna 0.10달러·0.50달러입니다

OpenAI GPT-6 Sol·Luna 공식 발표에서 공개한 표준 요금은 100만 토큰 기준입니다. 입력은 모델에게 보내는 글과 데이터, 출력은 모델이 만들어 낸 답변을 뜻합니다.

모델 주요 용도 입력 100만 토큰 캐시 입력 출력 100만 토큰
GPT-6 Sol 코딩·에이전트·복잡한 업무 $2.00 $0.20 $10.00
GPT-6 Luna 분류·추출·대량 반복 $0.10 $0.01 $0.50

이전 GPT-5.6 Sol은 입력 4달러·출력 20달러였으므로 정확히 절반입니다. GPT-5.6 Luna는 입력 0.20달러에서 0.10달러로 절반이 됐고, 출력은 1.20달러에서 0.50달러로 내려가 약 58.3% 인하됐습니다. OpenAI가 두 모델을 묶어 ‘50% 저렴’이라고 설명하지만 Luna 출력만 따로 계산하면 인하 폭이 더 큽니다.

긴 입력과 처리 방식에 따라 실제 단가는 달라집니다

OpenAI API 공식 요금표을 보면 기본 요금표 아래에 예외가 있습니다. 입력이 27만2천 토큰을 넘으면 그 요청 전체에 장문 요금이 적용되고, Batch와 Flex는 표준 요금의 절반, Fast 모드는 적용 요금의 두 배입니다.

조건 Sol 입력·출력 Luna 입력·출력 확인할 점
표준 단문 $2·$10 $0.10·$0.50 100만 토큰 기준 기본값
27만2천 토큰 초과 입력 $4·$15 $0.20·$0.75 요청 전체에 장문 단가 적용
Batch·Flex 표준의 50% 표준의 50% 즉시 응답이 필요 없는 작업에 적합
Fast 모드 적용 단가의 2배 적용 단가의 2배 빠른 처리 대신 비용 증가
지역 처리 10% 추가 10% 추가 지원 지역과 처리 방식을 먼저 확인

캐시 입력은 이미 보낸 긴 지시문이나 문서를 다시 사용할 때 적용되는 할인 단가입니다. 단, 새로 캐시에 쓰는 토큰에는 Sol $2.50, Luna $0.125의 ‘캐시 쓰기’ 비용이 별도로 붙습니다. 웹 검색이나 컴퓨터 사용 같은 도구는 토큰 요금 외에 호출 비용이 추가될 수 있습니다.

예산은 입력량·출력량·캐시 비율을 나눠 계산하세요

예를 들어 한 달 동안 입력 500만 토큰과 출력 100만 토큰을 표준 단문 요금으로 사용한다고 가정해 보겠습니다. 도구 호출비와 세금은 제외한 단순 계산입니다.

  1. Sol: 입력 500만×$2 + 출력 100만×$10 = $20
  2. Luna: 입력 500만×$0.10 + 출력 100만×$0.50 = $1
  3. 입력의 80%가 캐시에서 읽힌다면 Sol은 $12.80, Luna는 $0.64로 내려갑니다.

이 계산은 작업 품질이 같다는 뜻이 아닙니다. Luna로 여러 번 재시도해 출력이 길어지면 싸게 시작해도 총비용이 늘 수 있습니다. 지난달 로그에서 입력·출력·캐시 토큰을 분리한 뒤 두 모델로 작은 표본을 시험하는 것이 안전합니다.

일반 Chat과 ChatGPT Work는 서로 다른 화면입니다

‘ChatGPT에서 쓸 수 있다’는 설명만 보면 혼동하기 쉽습니다. 공식 발표 기준으로 Sol과 Luna는 ChatGPT Work와 Codex에 먼저 제공됐으며, 일반 Chat 대화창에는 아직 열리지 않았습니다.

사용 위치 GPT-6 Sol GPT-6 Luna 이용 조건
ChatGPT Work 가능 가능 Plus·Pro·Business·Enterprise·Edu
Codex 가능 가능 Plus·Pro·Business·Enterprise·Edu
OpenAI API gpt-6-sol gpt-6-luna API 계정과 사용량 과금 필요
무료·Go 데스크톱 앱 공식 발표에 없음 가능 Luna만 체험 가능
일반 Chat 대화창 아직 불가 아직 불가 점진 배포와 별개로 미제공
복잡한 코딩과 도구 작업에 맞춘 AI 모델과 대량 문서 분류에 맞춘 AI 모델의 이용 경로를 비교한 그림
왼쪽은 복잡한 코딩·도구 작업, 오른쪽은 대량 분류·추출 작업을 나타냅니다. 두 모델은 API와 Codex·ChatGPT Work에서 사용할 수 있지만 일반 Chat에는 아직 제공되지 않습니다.

배포는 계정별로 순차 진행되므로 ChatGPT Work나 Codex에서 바로 보이지 않을 수 있습니다. 이 경우 앱을 최신 상태로 두고 모델 선택 목록을 나중에 다시 확인하면 됩니다. 일반 Chat에서 보이지 않는 것은 오류가 아닙니다.

Sol과 Luna는 작업 난이도와 반복량으로 고르면 쉽습니다

GPT-6 Sol 공식 모델 문서GPT-6 Luna 공식 모델 문서에 따르면 두 모델 모두 105만 토큰의 컨텍스트 창과 최대 12만8천 출력 토큰을 지원합니다. 차이는 담을 수 있는 문서 크기보다, 어느 수준의 작업을 어떤 비용으로 처리하느냐에 있습니다.

이런 작업이라면 먼저 시험할 모델 이유
코드 수정·도구 여러 개 사용·긴 업무 흐름 GPT-6 Sol 복잡한 코딩과 에이전트 작업 중심
상품 분류·표에서 항목 추출·대량 요약 GPT-6 Luna 호출량이 많을 때 비용 부담이 작음
결과 품질이 비용보다 가장 중요한 작업 GPT-6 Astra OpenAI가 최상위 모델로 안내
어느 모델이 맞는지 모를 때 작은 표본으로 둘 다 시험 성공률·재시도·총 토큰을 함께 비교

추론 강도는 none, low, medium, high, xhigh, max를 지원합니다. 높은 단계는 어려운 문제에 도움이 될 수 있지만 추론 토큰과 대기 시간이 늘 수 있습니다. 공식 벤치마크의 높은 점수를 그대로 자신의 기본 설정 결과로 생각하면 안 됩니다.

API에서는 모델 이름과 추론 설정부터 바꾸면 됩니다

Responses API를 사용한다면 요청의 모델 값을 gpt-6-sol 또는 gpt-6-luna로 지정합니다. 기존 코드를 한꺼번에 바꾸기보다 같은 입력으로 결과 품질과 비용을 비교하세요.

{
  "model": "gpt-6-sol",
  "reasoning": { "effort": "medium" },
  "input": "이번 달 주문 내역에서 반품 사유를 분류해 줘"
}

GPT-6 모델 사용 지침은 도구 호출이 필요하면 Responses API 사용을 권장합니다. Chat Completions에서 Sol과 Luna의 함수 호출은 reasoning_effortnone일 때만 지원되므로 기존 연동 코드를 그대로 바꾸기 전 이 조건을 확인해야 합니다.

발표 성능표는 직접 업무 테스트로 다시 확인해야 합니다

OpenAI 공식 발표에서 Sol은 일부 업무 자동화·코딩 평가에서 상위 모델과 비슷하거나 더 높은 점수를 낮은 작업당 비용으로 기록했습니다. 하지만 경쟁 모델 점수는 공개 보고서에서 가져왔고, 연구 환경과 실제 서비스의 시스템 지시·도구도 다를 수 있다고 공식 문서가 밝히고 있습니다.

따라서 모델 선택은 벤치마크 순위 하나로 끝내지 말고 성공한 작업 수, 사람이 수정한 시간, 재시도 횟수, 전체 토큰 비용을 함께 기록해야 합니다. 싸지만 세 번 다시 실행하는 모델이 한 번에 끝내는 모델보다 비쌀 수 있습니다.

자주 묻는 질문(FAQ)

일반 ChatGPT 대화창에서 Sol이나 Luna를 선택할 수 있나요?

2026년 9월 23일 공식 안내 기준으로는 아직 선택할 수 없습니다. ChatGPT Work와 Codex, API에서 제공되며 무료·Go 사용자는 데스크톱 앱에서 Luna를 체험할 수 있습니다.

API 요금이 정말 모두 정확히 50% 내려갔나요?

Sol의 입력·출력과 Luna의 입력은 50% 인하입니다. Luna 출력은 $1.20에서 $0.50으로 내려 약 58.3% 인하됐습니다. 장문·Fast·지역 처리·도구 사용까지 포함한 실제 청구액은 별도로 계산해야 합니다.

소상공인의 상품 분류나 리뷰 정리에는 어떤 모델이 맞나요?

정해진 형식으로 많은 항목을 반복 처리한다면 Luna부터 시험하는 편이 합리적입니다. 여러 파일과 도구를 오가며 판단하거나 코드를 고치는 복잡한 자동화라면 Sol을 먼저 비교해 보세요.

지금 확인할 것은 네 가지입니다

  1. 사용 화면이 일반 Chat인지 ChatGPT Work·Codex인지 구분합니다.
  2. API 작업이라면 입력·출력·캐시 토큰을 따로 집계합니다.
  3. 27만2천 토큰을 넘는 장문 요청과 Fast·지역 처리 여부를 확인합니다.
  4. Sol과 Luna를 같은 표본으로 시험해 성공률과 총비용을 비교합니다.

공식 출처: OpenAI GPT-6 Sol·Luna 공식 발표, OpenAI API 공식 요금표, GPT-6 Sol 공식 모델 문서, GPT-6 Luna 공식 모델 문서

모델 제공 범위와 API 요금은 계정·지역·처리 방식에 따라 달라질 수 있으므로 OpenAI 공식 문서의 최신 값을 확인하세요.