Artificial Analysis 將 Ming-Image-0.1-Design 列為開源權重 UI/UX 模型第一
在 Artificial Analysis 的 Text to Image 排行榜上,60 億參數的 Ming-Image-0.1-Design 於 UI/UX 設計類別排第 17(共 81 名),並在開源權重模型中居首;整體則排第 45(共 160 名)。該模型以 MIT 授權發布,支援 RGBA 輸出,並以 2K 解析度、12 步推理進行評測。
在 Artificial Analysis 的 Text to Image 排行榜上,60 億參數的 Ming-Image-0.1-Design 於 UI/UX 設計類別排第 17(共 81 名),並在開源權重模型中居首;整體則排第 45(共 160 名)。該模型以 MIT 授權發布,支援 RGBA 輸出,並以 2K 解析度、12 步推理進行評測。
權重、程式碼、微調方案、基準測試及可重現範例正在發布。Black Forest Labs 表示,這款世界動作模型在 RoboLab 排名第一,較此前最佳開放模型高出 6.1 個百分點,參數少 56%,運行速度最高快 3.95 倍。
B.AI 現於其 API 及網頁聊天提供 Xiaomi MiMo 的開放權重模型 MiMo-V2.6-Pro 與 MiMo-V2.6-Flash。兩者均為原生多模態推理模型,具備 1M 上下文窗口,並可完整理解文字、圖像、影片與音訊。
Artificial Analysis 發現,沒有單一開源權重文字轉語音模型在全部九個新語言排行榜領先。領先位置分屬 Higgs Audio V3 TTS、OpenAudio S1 Mini、Voxtral TTS 和 Breeze TTS 2。
在 Artificial Analysis 的排名中,沒有單一開源權重文字轉語音模型在全部九種語言領先。Higgs Audio V3 TTS、OpenAudio S1 Mini、Voxtral TTS 與 Breeze TTS 2 各自在不同語言的開源權重組別居首,而每個榜單只收錄 2 至 6 個開源權重模型。
StepFun 強調 Artificial Analysis 結果顯示,Step 5 Preview 於 Intelligence Index 取得 44 分,每項任務成本為 0.71 美元,並將於 10 月 15 日公布更多消息。該評測描述這是一款 6000 億/270 億參數的 MoE 旗艦模型,提供第一方 API 存取,並計劃於 10 月 15 日開放權重。
Cline 表示旗艦模型 MiMo-v2.6-Pro 已正式推出,並已可在 ClinePass 使用。Cline 亦稱此模型是人工智能指數上表現最佳的開放權重模型。
阿里雲宣布推出 Qwen-Image-2.1,一款統一的 7B 圖像生成與編輯模型,並開放權重。該公司表示,模型可原生處理 RGBA 圖層,支援最多 10 張參考圖像,並已於 GitHub、ModelScope 及 Hugging Face 上提供。
ComfyUI 表示現已支援 Qwen-Image-2.1,並描述其為用於生成與編輯的開放權重 7B 檢查點。Qwen 引用該公告並強調 ComfyUI 的支援。
Qwen 宣布 Qwen-Image-2.1,表示這款 7B 模型統一圖像生成與編輯,權重現已開放。該公司表示,模型原生處理 RGBA 圖層,支援最多 10 張參考圖像,並提供精確局部控制。