GPT-6 提示快取可透過斷點與預熱調整
OpenAI Developers 表示,應用程式可用明確的快取斷點選擇可重用的提示前綴,在保留已快取上下文的同時調整推理力度與工具可用性,並預熱共享上下文,讓回應更快開始。
OpenAI Developers 表示,應用程式可用明確的快取斷點選擇可重用的提示前綴,在保留已快取上下文的同時調整推理力度與工具可用性,並預熱共享上下文,讓回應更快開始。
預設快取命中率提高,讓更多 GPT-6 輸入 token 可獲最高 90% 的快取輸入折扣。OpenAI Developers 表示,這項改動有助代理運行更快、成本更低。
platform.openai.com 上的全新 Prompt Caching Dashboard 會追蹤快取命中率。診斷 API 可識別阻礙快取重用的變更,並估算受影響的 token 數量。
OpenRouter 表示,GPT-6 Sol 與 GPT-6 Luna 採用 Astra 那種更清晰、更簡短、術語更少的回答,並包含 OpenAI 改進後的提示快取,快取輸入讀取減價 90%。
Kimi.ai 表示,Kimi K3 已可在 Amazon Bedrock 上使用,適用於程式編寫、文件分析及延伸代理工作流程,並配備 Bedrock 的存取、加密及審計控制,同時支援明確提示快取。