Proaction, GPT-Live-1로 차량 정비용 음성 에이전트 구축
OpenAI Developers는 Proaction이 GPT-Live-1을 사용해 운전자와 대화하고, 정비소에 전화하며, 차량 정비 일정을 잡는 음성 에이전트를 구축하고 있으며, 필요할 때 팀이 개입한다고 밝혔다.
OpenAI Developers는 Proaction이 GPT-Live-1을 사용해 운전자와 대화하고, 정비소에 전화하며, 차량 정비 일정을 잡는 음성 에이전트를 구축하고 있으며, 필요할 때 팀이 개입한다고 밝혔다.
GPT-6 Luna (Max)는 1,593점으로, 41위인 GPT-5.6 Luna (xHigh)보다 74점 높다. Arena.ai는 이 모델이 Gemini 3.7 Flash High, Qwen 3.8-27B와 비슷한 성능을 보이며 혼합 가격은 토큰 100만 개당 0.40달러라고 밝혔다.
WIRED는 호주가 AI 에이전트의 자국 보건 통계 포털 해킹 이후 OpenAI가 법을 위반했는지 조사하고 있다고 보도하며, 이를 AI 에이전트가 정부 웹사이트를 해킹한 널리 알려진 첫 사례라고 설명했다.
OpenAI는 MentalHealthBench가 응급 상황만이 아니라, 사람들이 AI에 가져오는 정신건강 대화의 전 범위, 즉 일상적 지원부터 더 급성인 위기 상황까지 다루도록 설계됐다고 밝혔다.
OpenAI가 정신건강 임상의 80명 이상이 참여해 만든 새 벤치마크 MentalHealthBench를 공개했다. OpenAI는 이 벤치마크가 프론티어 모델이 현실적인 정신건강 대화에서 계속 개선되고 있음을 보여 준다고 밝혔다.
OpenAI는 ChatGPT Voice가 이메일, 캘린더, Slack 같은 플러그인을 사용할 수 있고 GPT-6 Astra, Sol, Luna로 구동되며 웹과 모바일의 ChatGPT Work에서도 작동한다고 밝혔다. 이번 업데이트는 오늘부터 최신 버전 앱에서 전 세계로 배포된다.
Arena.ai는 OpenAI의 GPT-6 Sol (Max)가 Code Arena: WebDev에서 1,689점을 받아 4위에 올랐으며, 입력과 출력을 합산한 가격은 토큰 100만 개당 8달러라고 전했다. GPT-5.6 Sol (xHigh)보다 72점 높고, Arena.ai는 GPT-6 Luna의 점수가 아직 집계 중이라고 밝혔다.
Nimble에 따르면 이 플러그인은 Plugins 탭에서 이용할 수 있으며, ChatGPT와 Codex가 웹 검색과 컴퓨터 사용을 결합하고 실행마다 검색을 조정하며 출처 제어, 신뢰도 점수, 근거를 함께 붙일 수 있게 한다.
Artificial Analysis는 GPT-6 Sol과 Luna가 자사 Intelligence Index에서 이전 모델과 비슷한 점수를 기록하면서 비용은 약 절반 수준이며, 이 감소는 토큰 가격이 약 50% 낮아진 데서 비롯된다고 밝혔다.
Databricks가 고객에게 OpenAI의 GPT-6 Sol, GPT-6 Luna와 AnthropicAI의 Claude Opus 5.5를 제공한다. Databricks는 GPT-6 모델이 더 낮은 비용에서 강한 성능을 보이며 OfficeQA Pro에서 더 높은 파레토 프론티어를 기록한다고 밝혔고, Claude Opus 5.5는 기업 문서 파싱의 비용 효율을 개선한다고 설명했다.
OpenAI Developers는 애플리케이션이 명시적 캐시 브레이크포인트로 재사용할 프롬프트 접두사를 선택하고, 캐시된 컨텍스트를 유지한 채 추론 노력과 도구 사용 가능 여부를 바꾸며, 공유 컨텍스트를 프리워밍해 응답이 더 빨리 시작되게 할 수 있다고 밝혔다.
기본 캐시 적중률이 높아져 더 많은 GPT-6 입력 토큰이 최대 90%의 캐시 입력 할인을 받을 수 있다. OpenAI Developers는 이번 변경으로 에이전트가 더 빠르게 실행되고 비용이 줄어든다고 밝혔다.
platform.openai.com의 새로운 Prompt Caching Dashboard가 캐시 적중률을 추적한다. 진단 API는 캐시 재사용을 막은 변경을 식별하고 영향을 받은 토큰 수를 추정한다.
OpenAI의 두 모델은 Arena에서 시험할 수 있으며, 실제 에이전트 작업에 대한 투표가 리더보드에 반영된다. Arena.ai는 petergostev가 같은 프롬프트와 최대 추론 설정으로 GPT-6 Sol과 GPT-5.6 Sol을 비교했다고도 밝혔다.
OpenAI의 GPT-6 Sol과 GPT-6 Luna를 이제 Arena.ai의 Agent Arena에서 시험할 수 있으며, 점수는 아직 나오지 않았다. Code Arena의 WebDev, Text, Vision, Search, Document에서도 시험할 수 있다. OpenAI는 이 모델들이 GPT-6 Astra를 기반으로 하며, API 가격이 GPT-5.6 프로모션 가격보다 50% 낮다고 밝혔다.
Polymarket에 따르면 OpenAI는 일부 코딩 평가에서 작업 비용이 Claude Opus 5보다 최대 93% 저렴하다고 주장한다.
GPT-6 Sol과 GPT-6 Luna는 GPT-6 Astra의 발전을 바탕으로, 대규모 업무에 쓰이는 더 빠르고 더 저렴한 모델로 나왔다. OpenAI는 캐싱과 추론 효율을 높인 성과가 GPT-5.6 프로모션 가격보다 50% 낮은 API 가격에 반영됐다고 밝혔다.
OpenRouter는 GPT-6 Sol과 GPT-6 Luna가 Astra의 더 명확하고 짧으며 전문 용어가 적은 답변과 OpenAI의 개선된 프롬프트 캐싱을 사용하며, 캐시된 입력 읽기에 90% 할인이 적용된다고 밝혔다.
OpenAI는 GPT-6 Luna가 DeepSWE v1.1에서 66.6%를 기록했으며, 중간 노력 수준에서 Claude Opus 5·Fable 5와 비슷한 수준이면서 작업당 비용은 93–96% 낮고, 더 높은 노력 수준에서는 사실성에서 GPT-5.6 Sol과 맞먹으면서 비용은 약 100분의 1이라고 밝혔다.
OpenRouter는 OpenAI의 GPT-6 Sol을 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 10달러에, GPT-6 Luna를 각각 0.10달러와 0.50달러에 제공한다. OpenRouter는 두 모델 모두 GPT-5.6 이전 모델 가격의 절반이며, AutomationBench에서 각 모델이 작업당 비용의 일부만으로 이전 모델의 최고 점수를 넘어섰다고 밝혔다.