Yomna Shousha 推出 Worker Previews
Worker Previews 为智能体所做的每一项改动提供类生产环境。
Worker Previews 为智能体所做的每一项改动提供类生产环境。
这项工作将 ggml 的 Metal 内核引入 transformers 生态。Georgi Gerganov 称,此举可提升兼容性与性能。
他将这一结果归功于 SliceAttention 内核和 BatchedMuon,目前使用 Transolver,并称完整训练从 26 小时降至 22 小时,误差和质量没有显著变化。
个人 AI 助理 Today 的中国版将于9月正式上线,9月24日与用户见面,并提供 iOS、Android、Windows、Mac 和 Linux 版本。
oMLX 仍在同一仓库中以 Apache 2.0 许可证维护。Jun Kim 在 Hugging Face 全职从事该项目,并继续负责它。他说这项工作始于 2 月的个人项目。
Kimi.ai 表示,Kimi K3 已在 Amazon Bedrock 上可用,可用于编程、文档分析以及扩展智能体工作流,并具备 Bedrock 的访问、加密与审计控制,同时支持显式提示缓存。
StepFun 强调了 Artificial Analysis 的结果,Step 5 Preview 在 Intelligence Index 上得分为 44,每项任务 $0.71,并将于 10 月 15 日公布更多内容。该评估将其描述为 600B/27B MoE 旗舰模型,提供第一方 API 访问,并计划于 10 月 15 日开放权重。
腾讯混元表示 Hy Image3.5 预览版已上线,支持最高 2K 的文生图和图生图。腾讯云 API 定价为每张生成图片 $0.024,并仅在 OnSolo 和 Miora 上提供两周免费。
腾讯混元引用了 Zhihu Frontier 的一篇解读,介绍如何通过混合精度量化将 Hy4 preview 的 770B 参数权重从约 1.5TB 压缩至 214 GiB。被引用的文章称参数量保持不变,并报告 MRCR 几乎不变,数学能力略有下降。
Command Code 表示 Grok 4.7 现已在 Command Code 上线,并可在 GOAT、Pro、Max 以及通过 API 使用。该公司还列出了未来 7 天 40% 以及 GOAT 中 $35 额度(3.5x 用量)。
Dax(@thdxr)表示,Kit 完成了一篇博客文章,介绍 OpenCode 2.0 如何能够实时修改自身的一切,即使在运行中的会话期间也是如此。
TypeSafe 援引 MotherDuck 的说法称,由 TypeSafe 的 Jev 模型驱动的 SQL 函数 prompt_jev() 使文本分类速度约快 50 倍,成本约为原来的 1%。MotherDuck 报告称,100k 行数据耗时 40 秒、费用 $0.50,而使用 LLM 则需 32 分钟、费用 $37。
阿里云与ZAKA将携手举办为期两天的Qoder AI黑客马拉松,活动于10月6日至7日在阿布扎比ADNEC Centre举行的AI Everything阿布扎比2026上进行,参与者可使用Qoder构建可运行的AI解决方案。
Command Code 表示 MiMo V2.6 Pro 和 Flash 已在 Command Code 上线,并在所有套餐中可用。在 10 美元 GOAT 套餐上,其列出 MiMo-V2.6 Flash 为 67 美元(6.7 倍用量)72 小时,以及 MiMo-V2.6 Pro 为 20 美元(2 倍用量)。
Vercel said to build with Grok 4.7 and Vercel at a lower cost, with 40% off on AI Gateway until September 27th. The post also said to try it with @v0, @eve, and fx.
这一一次性方法把问题拆成线索,执行互补检索,并在智能体循环开始前对汇总结果重新排序。在 BrowseComp-Plus 上,使用相同检索器和智能体循环时,GPT-5.5 的准确率从 83.1% 升至 90.5%。
Cline 表示旗舰模型 MiMo-v2.6-Pro 已正式推出,并已在 ClinePass 上线。该公司还称该模型是人工智能指数上表现最佳的开放权重模型。
马克·扎克伯格表示,Muse 正与 Shopify 合作,让 Muse 中的购物和结账更便捷。他还表示,类似这样的合作即将到来。
v0 表示 Grok 4.7 现已在 v0 中可用,至 9 月 27 日优惠 40%。该帖引用了 SpaceXAI 关于 Grok 4.7 现已推出的公告。
谷歌上周表示,其推出了来自 Google DeepMind 的两款新音频模型 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,并且团队成员正在创意应用、实时支持和机器人领域使用这些模型进行构建。