Antigravity SDK 现已支持通过 Gemma 4 与 LiteRT 在本地运行
借助 Gemma 4 与 LiteRT,智能体工作流可以完全在本地机器上运行。该 SDK 还支持 OpenAI 兼容端点,包括 Ollama、llama.cpp 和 vLLM。
借助 Gemma 4 与 LiteRT,智能体工作流可以完全在本地机器上运行。该 SDK 还支持 OpenAI 兼容端点,包括 Ollama、llama.cpp 和 vLLM。
Polymarket 称,这些工具正在向约 100 个国家的医生推出,其中包括乌干达、苏丹、海地和蒙古。
2026 年 9 月 23 日,Cursor 在 Teams 与 Enterprise 方案中同时开放这两项功能,并表示将在接下来的 10 天提供 Rollouts 用量额度,方便用户在真实改动上试用 Rollouts。
Cursor 称,此次更新将 Security Reviewer 的平均耗时从 4.8 分钟降至 3.8 分钟。
Rollouts 会编写监控计划,并在变更部署时持续观察,验证部署情况,以便在用户看到之前发现回归。
GitHub 表示,该视图在包含 2,200 个文件、超过 100 万行变更以及超过 400 条行内评论的拉取请求中仍保持快速流畅。
WebCraftBench 让智能体使用正在运行的应用,再对美观度、可用性以及是否满足原始请求进行评分。Tencent Hy 称,在 197 组经人工验证的配对上,其结果与人类偏好的一致率为 85.3%。
Cline 称这款 stealth 模型已在 Cline 中免费提供,支持多模态输入,上下文窗口为 100 万 token。Cline 还称该模型推理速度快,编程能力强。
Codex 规划器与创建器将每项技能转化为经过测试的终端工作流,评分标准取自该技能自身的质量标准。仅按结果的强化学习使 Qwen3.8-27B 在 Terminal-Bench 2.1 上从 49.4% 提升至 54.1%;加入评分标准后达到 50.1%,但在轨迹比较中胜出更多。
Arena.ai 表示,已生成 Anthropic 的 Claude Opus 5.5 与 OpenAI 的 GPT-6 Sol 的并排输出,Claude Opus 5.5 的评分即将公布。
这些短时环境会同时捕获 schema 和数据,因此测试不会影响生产环境。工作流使用 Databricks CLI 和 AGENTS.md,在已批准的更新进入 CI/CD 之前,将变更与父分支进行比较。
用户可以添加 Slack、Notion 等连接器和插件,购买 Cursor、CrowdStrike 等公司的智能体与产品,并借助 Accenture、Deloitte 等服务合作伙伴扩大规模。
ClaudeDevs 表示,它在两周内将 claude.ai 的速度提升至原来的三倍,并介绍了使用 Claude 测量、调试和改善性能的做法,其中包含提示词与方法。
Neal Mohan 在 Made on YouTube 上表示,YouTube 发布了超过 30 项面向创作者、艺人和观众的新功能与产品。用户很快将能用简单的对话式提示,为任意心情或日常安排设计专属主页信息流。
OpenAI 表示,MentalHealthBench 面向人们向 AI 提出的各类心理健康对话,从日常支持到更急性的危机场景,而不只是紧急情况。
OpenAI 已公开发布 MentalHealthBench。这项新基准由 80 多名心理健康临床人员参与构建。OpenAI 表示,它显示前沿模型在真实心理健康对话中持续改进。
Google 新闻称,Gemini Omni 1.1 Flash 与一套新的创意控制功能现已进入 Google Vids。任何拥有 Google 账号的用户都可以在那里免费制作视频,无需专业剪辑技能。
Cline 将这项优惠与 cline.bot/desktop 上的 Kimi K3 促销关联,但未说明结束日期或资格限制。
并行任务各自在 ~/.cline/worktrees/<id> 下的独立分支上运行。该版本还会在 gh 可用时显示分支的拉取请求链接、合并状态和 CI 检查,并能在同一会话中把多项任务分配给子代理。
在 DaVinci Resolve 中,Runway 可直接在时间线上生成、编辑和放大,无需离开项目。