Antigravity SDK 現已支援以 Gemma 4 與 LiteRT 進行本機執行
代理式工作流程可透過 Gemma 4 與 LiteRT 完全在本機運行。SDK 亦支援 OpenAI 相容端點,包括 Ollama、llama.cpp 與 vLLM。
代理式工作流程可透過 Gemma 4 與 LiteRT 完全在本機運行。SDK 亦支援 OpenAI 相容端點,包括 Ollama、llama.cpp 與 vLLM。
Polymarket 稱,相關工具正面向約 100 個國家的醫生推出,包括烏干達、蘇丹、海地和蒙古。
2026年9月23日,Cursor 在 Teams 與 Enterprise 方案開放上述兩項功能,並表示未來 10 日會附送 Rollouts 用量額度,讓用戶可在真實變更上試用 Rollouts。
Cursor 表示,這次更新將 Security Reviewer 的平均耗時由 4.8 分鐘減至 3.8 分鐘。
Rollouts 會撰寫監控計劃,並在變更部署時持續觀察,從而驗證部署,讓迴歸問題在用戶看到之前被發現。
GitHub 表示,這個檢視在一個包含 2,200 個檔案、超過 100 萬行變更,以及超過 400 則行內評論的拉取請求中,仍然快速而流暢。
WebCraftBench 讓代理實際使用線上應用,再就美感、可用性,以及是否滿足原始要求評分。Tencent Hy 表示,在 197 組經驗證的配對中,與人類偏好的吻合率為 85.3%。
Cline 表示,這款隱身模型可在 Cline 免費使用,支援多模態輸入,上下文視窗為 100 萬 token。Cline 亦形容該模型推理速度快,程式編寫能力強。
Codex 規劃器與建立器把每項技能轉成經過測試的終端機工作流程,評分標準取自該技能本身的質素準則。只看結果的強化學習把 Qwen3.8-27B 在 Terminal-Bench 2.1 的表現由 49.4% 提升至 54.1%;加入評分標準後則達 50.1%,但在軌跡比較中勝出更多。
Arena.ai 表示,已生成 Anthropic 的 Claude Opus 5.5 與 OpenAI 的 GPT-6 Sol 的並排輸出,並指 Claude Opus 5.5 的分數即將公布。
這些短期環境會同時擷取結構與資料,測試因此不會影響正式環境。工作流程使用 Databricks CLI 與 AGENTS.md,先把變更與父分支比較,獲批准的更新再經 CI/CD 推進。
用戶可以加入 Slack、Notion 等連接器與外掛程式,向 Cursor、CrowdStrike 等公司購買智能體及產品,並與 Accenture、Deloitte 等服務合作夥伴擴大規模。
ClaudeDevs 表示,它在兩週內令 claude.ai 快三倍,並說明使用 Claude 量度、除錯及改善效能,當中包括提示詞與方法。
Neal Mohan 在 MadeOnYouTube 表示,YouTube 公布了超過 30 項面向創作者、藝人與觀眾的新功能及產品。用戶即將能以簡單的對話式提示,按任何心情或日常習慣設計專屬主頁動態。
OpenAI 表示,MentalHealthBench 旨在涵蓋人們向 AI 提出的各類精神健康對話,範圍由日常支援延伸至較急性的危機情境,而不僅限於緊急情況。
OpenAI 已公開發布 MentalHealthBench。這項新基準由超過 80 名心理健康臨床人員參與制定。OpenAI 表示,基準顯示前沿模型在真實心理健康對話中持續改善。
Google 消息指,Gemini Omni 1.1 Flash 及一套新的創作控制功能現已加入 Google Vids。任何持有 Google 帳戶的人都可以在該處免費製作影片,無需專業剪輯技能。
Cline 將此優惠與 cline.bot/desktop 上的 Kimi K3 推廣活動掛鈎,但未說明結束日期或資格限制。
並行任務各自在 ~/.cline/worktrees/<id> 下的獨立分支執行。今次更新亦會在 gh 可用時顯示分支的拉取請求連結、合併狀態與 CI 檢查,並可在同一工作階段把多項任務交由 subagents 處理。
在 DaVinci Resolve 內,Runway 可直接在時間軸上生成、編輯及提升解像度,無需離開專案。