JEV 캐스케이드는 GPT-6 정확도의 99%를 약 57% 비용으로 유지
Jev-as-a-Judge 논문은 TypeSafe AI의 확신 있는 JEV 판정을 받아들이고 나머지는 GPT-6 Astra로 올리면, 510개 홀드아웃 선호 쌍에서 GPT-6 정확도의 99%를 GPT-6 비용의 약 57%로 유지했다고 보고한다. 저자들은 상향 임계값이 모든 폴백 모델로 전이되지 않았으며 자체 데이터에서 설정해야 한다고 말한다.
Jev-as-a-Judge 논문은 TypeSafe AI의 확신 있는 JEV 판정을 받아들이고 나머지는 GPT-6 Astra로 올리면, 510개 홀드아웃 선호 쌍에서 GPT-6 정확도의 99%를 GPT-6 비용의 약 57%로 유지했다고 보고한다. 저자들은 상향 임계값이 모든 폴백 모델로 전이되지 않았으며 자체 데이터에서 설정해야 한다고 말한다.
OpenAI는 ChatGPT Voice가 이메일, 캘린더, Slack 같은 플러그인을 사용할 수 있고 GPT-6 Astra, Sol, Luna로 구동되며 웹과 모바일의 ChatGPT Work에서도 작동한다고 밝혔다. 이번 업데이트는 오늘부터 최신 버전 앱에서 전 세계로 배포된다.
Codex CLI 0.156.1의 모델 선택기에 GPT-6 Sol과 GPT-6 Luna가 포함된다. 속도 제한 전환은 이제 GPT-6 Luna를 제안하며, 모델 카탈로그도 업데이트됐다.
Artificial Analysis는 GPT-6 Sol과 Luna가 자사 Intelligence Index에서 이전 모델과 비슷한 점수를 기록하면서 비용은 약 절반 수준이며, 이 감소는 토큰 가격이 약 50% 낮아진 데서 비롯된다고 밝혔다.
Glean은 자체 평가에서 Claude Opus 5.5의 토큰 비용이 이전 모델보다 50% 낮다고 밝혔으며, GPT-6 Luna와 GPT-6 Sol도 각각 이전 모델보다 50% 저렴하다고 했다.
Luna는 모든 요금제와 API에서 이용할 수 있으며, 예시로 제시된 10달러 GOAT 요금제는 약 3만 건의 요청과 약 15억 토큰을 포함한다. Sol은 Pro와 Max 요금제, 그리고 API에서 이용할 수 있다.
Databricks가 고객에게 OpenAI의 GPT-6 Sol, GPT-6 Luna와 AnthropicAI의 Claude Opus 5.5를 제공한다. Databricks는 GPT-6 모델이 더 낮은 비용에서 강한 성능을 보이며 OfficeQA Pro에서 더 높은 파레토 프론티어를 기록한다고 밝혔고, Claude Opus 5.5는 기업 문서 파싱의 비용 효율을 개선한다고 설명했다.
OpenAI Developers는 애플리케이션이 명시적 캐시 브레이크포인트로 재사용할 프롬프트 접두사를 선택하고, 캐시된 컨텍스트를 유지한 채 추론 노력과 도구 사용 가능 여부를 바꾸며, 공유 컨텍스트를 프리워밍해 응답이 더 빨리 시작되게 할 수 있다고 밝혔다.
기본 캐시 적중률이 높아져 더 많은 GPT-6 입력 토큰이 최대 90%의 캐시 입력 할인을 받을 수 있다. OpenAI Developers는 이번 변경으로 에이전트가 더 빠르게 실행되고 비용이 줄어든다고 밝혔다.
OpenAI의 두 모델은 Arena에서 시험할 수 있으며, 실제 에이전트 작업에 대한 투표가 리더보드에 반영된다. Arena.ai는 petergostev가 같은 프롬프트와 최대 추론 설정으로 GPT-6 Sol과 GPT-5.6 Sol을 비교했다고도 밝혔다.
Arena.ai에서 두 모델 모두 Battle Mode와 Agent Mode를 써볼 수 있다.
OpenAI의 GPT-6 Sol과 GPT-6 Luna를 이제 Arena.ai의 Agent Arena에서 시험할 수 있으며, 점수는 아직 나오지 않았다. Code Arena의 WebDev, Text, Vision, Search, Document에서도 시험할 수 있다. OpenAI는 이 모델들이 GPT-6 Astra를 기반으로 하며, API 가격이 GPT-5.6 프로모션 가격보다 50% 낮다고 밝혔다.
GitHub Copilot이 OpenAIDevs GPT-6 모델 두 가지를 추가로 정식 제공한다. 대화형·에이전트형 코딩용 GPT-6 Sol과, GitHub가 소규모 작업용 경량·최저가 옵션이라고 부르는 GPT-6 Luna다.
샘 알트먼은 GPT-6 Sol과 Luna가 지능, 정렬, 작업 산출, 코딩, 컴퓨터 사용에서 5.6 계열 이전 모델보다 크게 개선됐으며, 토큰당 가격은 절반이고 작업당 가격은 그보다 더 낮다고 밝혔다. 그는 작업당 가격 기준으로는 시장에서 경쟁할 만한 것이 없다고 본다고 말했다.
Polymarket에 따르면 OpenAI는 일부 코딩 평가에서 작업 비용이 Claude Opus 5보다 최대 93% 저렴하다고 주장한다.
그는 두 모델 모두 지능, 정렬, 작업 산출, 코딩, 컴퓨터 사용 면에서 5.6 계열 이전 모델보다 크게 개선됐으며, 작업당 비용은 그보다 더 낮다고 말한다.
GPT-6 Sol과 GPT-6 Luna는 GPT-6 Astra의 발전을 바탕으로, 대규모 업무에 쓰이는 더 빠르고 더 저렴한 모델로 나왔다. OpenAI는 캐싱과 추론 효율을 높인 성과가 GPT-5.6 프로모션 가격보다 50% 낮은 API 가격에 반영됐다고 밝혔다.
OpenRouter는 GPT-6 Sol과 GPT-6 Luna가 Astra의 더 명확하고 짧으며 전문 용어가 적은 답변과 OpenAI의 개선된 프롬프트 캐싱을 사용하며, 캐시된 입력 읽기에 90% 할인이 적용된다고 밝혔다.
OpenRouter는 OpenAI의 GPT-6 Sol을 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 10달러에, GPT-6 Luna를 각각 0.10달러와 0.50달러에 제공한다. OpenRouter는 두 모델 모두 GPT-5.6 이전 모델 가격의 절반이며, AutomationBench에서 각 모델이 작업당 비용의 일부만으로 이전 모델의 최고 점수를 넘어섰다고 밝혔다.
2026년 9월 22일 출시는 Plus, Pro, Business, Enterprise, Edu 사용자를 대상으로 한다.