Proaction 正在打造用于车辆保养的 GPT-Live-1 语音智能体
OpenAI Developers 表示,Proaction 正在使用 GPT-Live-1 打造语音智能体,与司机对话、致电维修店并协助安排车辆保养,必要时由团队介入。
OpenAI Developers 表示,Proaction 正在使用 GPT-Live-1 打造语音智能体,与司机对话、致电维修店并协助安排车辆保养,必要时由团队介入。
GPT-6 Luna(Max)得分为 1,593 分,比排在第 41 位的 GPT-5.6 Luna(xHigh)高 74 分。Arena.ai 称,它与 Gemini 3.7 Flash High 和 Qwen 3.8-27B 表现相当,综合价格为每百万 token 0.40 美元。
WIRED 报道,澳大利亚正在调查 OpenAI 在一名 AI 智能体入侵该国卫生统计门户后是否违法,并称这是首个广为人知的 AI 智能体入侵政府网站案例。
OpenAI 表示,MentalHealthBench 面向人们向 AI 提出的各类心理健康对话,从日常支持到更急性的危机场景,而不只是紧急情况。
OpenAI 已公开发布 MentalHealthBench。这项新基准由 80 多名心理健康临床人员参与构建。OpenAI 表示,它显示前沿模型在真实心理健康对话中持续改进。
OpenAI 表示,ChatGPT Voice 可以使用电子邮件、日历和 Slack 等插件,运行 GPT-6 Astra、Sol 和 Luna,并在网页端与移动端的 ChatGPT Work 中使用。该更新即日起在最新版应用中全球推出。
Arena.ai 报告称,OpenAI 的 GPT-6 Sol (Max) 在 Code Arena: WebDev 中获得 1,689 分,排名第四,输入与输出混合价格为每百万 token 8 美元。该分数比 GPT-5.6 Sol (xHigh) 高 72 分,而 Arena.ai 表示 GPT-6 Luna 的分数仍待公布。
Nimble 表示,该插件已在 Plugins 标签页提供,可让 ChatGPT 和 Codex 将网页搜索与计算机操作结合,在每次运行后调整检索,并为结果附加来源控制、置信度分数和证据。
Artificial Analysis 称,GPT-6 Sol 与 Luna 在其 Intelligence Index 上的得分与前代相近,成本约为前代的一半;成本下降主要来自 token 价格约降低 50%。
Databricks 向客户提供 OpenAI 的 GPT-6 Sol、GPT-6 Luna 以及 AnthropicAI 的 Claude Opus 5.5。Databricks 表示,GPT-6 模型以更低成本实现较强表现,并在 OfficeQA Pro 上具有更高的帕累托前沿;Claude Opus 5.5 则提升了企业文档解析的成本效率。
OpenAI Developers 表示,应用可通过显式缓存断点选择可复用的提示前缀,在保留已缓存上下文的同时调整推理力度和工具可用性,并可预热共享上下文,使响应更早开始。
默认缓存命中率提高后,更多 GPT-6 输入 token 可获得最高 90% 的缓存输入折扣。OpenAI Developers 表示,这一改动有助于智能体运行更快、成本更低。
platform.openai.com 上的全新 Prompt Caching Dashboard 会跟踪缓存命中率。诊断 API 可识别阻碍缓存复用的改动,并估算受影响的 token 数量。
OpenAI 的两款模型已可在 Arena 上测试,针对真实世界智能体任务的投票会计入排行榜。Arena.ai 称,petergostev 还用相同提示词、在最高推理设置下比较了 GPT-6 Sol 与 GPT-5.6 Sol。
OpenAI 的 GPT-6 Sol 与 GPT-6 Luna 现可在 Arena.ai 的 Agent Arena 中测试,分数尚未公布;也可在 Code Arena 的 WebDev、Text、Vision、Search 与 Document 类别中测试。OpenAI 称,这两款模型建立在 GPT-6 Astra 的进展之上,API 价格比 GPT-5.6 的促销价低 50%。
据 Polymarket 称,OpenAI 表示,在部分编程评测中,任务成本比 Claude Opus 5 最多低 93%。
GPT-6 Sol 与 GPT-6 Luna 基于 GPT-6 Astra 背后的进展,面向大规模工作提供更快、更实惠的模型。OpenAI 表示,更高效的缓存与推理已反映在 API 价格上,较 GPT-5.6 促销价低 50%。
OpenRouter 表示,GPT-6 Sol 和 GPT-6 Luna 采用 Astra 更清晰、更简短、术语更少的回答方式,并包含 OpenAI 改进后的提示缓存,缓存输入读取减免 90%。
OpenAI 报告,GPT-6 Luna 在 DeepSWE v1.1 上得分为 66.6%,与中等 effort 下的 Claude Opus 5 和 Fable 5 相当,且每项任务成本低 93%–96%;在更高 effort 下,其事实性与 GPT-5.6 Sol 相当,成本约为后者的百分之一。
OpenRouter 提供 OpenAI 的 GPT-6 Sol,输入每百万 token 2 美元,输出每百万 token 10 美元;GPT-6 Luna 分别为 0.10 美元和 0.50 美元。OpenRouter 称,两者价格均为各自 GPT-5.6 前代的一半,且在 AutomationBench 上均超过前代最佳分数,而每项任务成本只占其一小部分。