Did Codex Reset
GitHub

#gpt-6

모든 AI 뉴스 보기
TGRSS 피드총 26건

JEV 캐스케이드는 GPT-6 정확도의 99%를 약 57% 비용으로 유지

Jev-as-a-Judge 논문은 TypeSafe AI의 확신 있는 JEV 판정을 받아들이고 나머지는 GPT-6 Astra로 올리면, 510개 홀드아웃 선호 쌍에서 GPT-6 정확도의 99%를 GPT-6 비용의 약 57%로 유지했다고 보고한다. 저자들은 상향 임계값이 모든 폴백 모델로 전이되지 않았으며 자체 데이터에서 설정해야 한다고 말한다.

Databricks, OpenAI GPT-6 Sol·GPT-6 Luna와 AnthropicAI Claude Opus 5.5 제공

Databricks가 고객에게 OpenAI의 GPT-6 Sol, GPT-6 Luna와 AnthropicAI의 Claude Opus 5.5를 제공한다. Databricks는 GPT-6 모델이 더 낮은 비용에서 강한 성능을 보이며 OfficeQA Pro에서 더 높은 파레토 프론티어를 기록한다고 밝혔고, Claude Opus 5.5는 기업 문서 파싱의 비용 효율을 개선한다고 설명했다.

GPT-6 프롬프트 캐싱은 브레이크포인트와 프리워밍으로 조정할 수 있다

OpenAI Developers는 애플리케이션이 명시적 캐시 브레이크포인트로 재사용할 프롬프트 접두사를 선택하고, 캐시된 컨텍스트를 유지한 채 추론 노력과 도구 사용 가능 여부를 바꾸며, 공유 컨텍스트를 프리워밍해 응답이 더 빨리 시작되게 할 수 있다고 밝혔다.

Arena.ai, Agent Arena와 Code Arena에 GPT-6 Sol과 GPT-6 Luna 추가

OpenAI의 GPT-6 Sol과 GPT-6 Luna를 이제 Arena.ai의 Agent Arena에서 시험할 수 있으며, 점수는 아직 나오지 않았다. Code Arena의 WebDev, Text, Vision, Search, Document에서도 시험할 수 있다. OpenAI는 이 모델들이 GPT-6 Astra를 기반으로 하며, API 가격이 GPT-5.6 프로모션 가격보다 50% 낮다고 밝혔다.

샘 알트먼, GPT-6 Sol과 Luna는 토큰당 가격이 절반이라고 밝혀

샘 알트먼은 GPT-6 Sol과 Luna가 지능, 정렬, 작업 산출, 코딩, 컴퓨터 사용에서 5.6 계열 이전 모델보다 크게 개선됐으며, 토큰당 가격은 절반이고 작업당 가격은 그보다 더 낮다고 밝혔다. 그는 작업당 가격 기준으로는 시장에서 경쟁할 만한 것이 없다고 본다고 말했다.

GPT-6 Sol과 GPT-6 Luna, OpenRouter에서 이용 가능

OpenRouter는 OpenAI의 GPT-6 Sol을 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 10달러에, GPT-6 Luna를 각각 0.10달러와 0.50달러에 제공한다. OpenRouter는 두 모델 모두 GPT-5.6 이전 모델 가격의 절반이며, AutomationBench에서 각 모델이 작업당 비용의 일부만으로 이전 모델의 최고 점수를 넘어섰다고 밝혔다.