Artificial Analysis 将 Ming-Image-0.1-Design 列为开源权重 UI/UX 模型第一
在 Artificial Analysis 的 Text to Image 排行榜上,60 亿参数的 Ming-Image-0.1-Design 在 UI/UX 设计类别中位列 81 个模型中的第 17,并在开源权重模型中排名第一;综合排名为 160 个模型中的第 45。该模型以 MIT 许可证发布,支持 RGBA 输出,评测分辨率为 2K,推理步数为 12。
在 Artificial Analysis 的 Text to Image 排行榜上,60 亿参数的 Ming-Image-0.1-Design 在 UI/UX 设计类别中位列 81 个模型中的第 17,并在开源权重模型中排名第一;综合排名为 160 个模型中的第 45。该模型以 MIT 许可证发布,支持 RGBA 输出,评测分辨率为 2K,推理步数为 12。
权重、代码、微调方案、基准测试和可复现示例正在发布。Black Forest Labs 称,这款世界动作模型在 RoboLab 上排名第一,领先此前最佳开源模型 6.1 个百分点,参数少 56%,运行速度最高快 3.95 倍。
B.AI 现已在其 API 和网页聊天中提供 Xiaomi MiMo 的开源权重模型 MiMo-V2.6-Pro 与 MiMo-V2.6-Flash。两者均为原生多模态推理模型,上下文窗口为 100 万,并完整支持文本、图像、视频和音频理解。
Artificial Analysis发现,没有单一开放权重文本转语音模型在全部九个新语言排行榜上领先。领先位置由Higgs Audio V3 TTS、OpenAudio S1 Mini、Voxtral TTS和Breeze TTS 2分占。
在 Artificial Analysis 的排名中,没有任何单一开放权重文本转语音模型在全部九种语言上领先。Higgs Audio V3 TTS、OpenAudio S1 Mini、Voxtral TTS 和 Breeze TTS 2 分别在不同语言的开放权重榜上居首,且每个榜单只收录 2 到 6 个开放权重模型。
StepFun 强调了 Artificial Analysis 的结果,Step 5 Preview 在 Intelligence Index 上得分为 44,每项任务 $0.71,并将于 10 月 15 日公布更多内容。该评估将其描述为 600B/27B MoE 旗舰模型,提供第一方 API 访问,并计划于 10 月 15 日开放权重。
Cline 表示旗舰模型 MiMo-v2.6-Pro 已正式推出,并已在 ClinePass 上线。该公司还称该模型是人工智能指数上表现最佳的开放权重模型。
阿里云宣布推出 Qwen-Image-2.1,这是一款开放权重的统一 7B 图像生成与编辑模型。该公司表示,该模型可原生处理 RGBA 图层,最多支持 10 张参考图像,并已在 GitHub、ModelScope 和 Hugging Face 上提供。
ComfyUI 表示现已支持 Qwen-Image-2.1,称其为一个用于生成与编辑的开放权重 7B 检查点。Qwen 引用了该公告并强调了 ComfyUI 的支持。
Qwen 宣布推出 Qwen-Image-2.1,称该 7B 模型统一了图像生成与编辑,且权重现已开源。该公司表示,该模型原生处理 RGBA 图层,支持最多 10 张参考图像,并提供精确的局部控制。