Runway MCP 可直接連接 Claude 生成圖像與影片
Runway MCP 可直接連接 Claude,包括 Claude Opus 5.5,並以 Gen-4.5、Seedance 2.5、GPT Image 2、Kling 及其他模型生成圖像與影片。
Runway MCP 可直接連接 Claude,包括 Claude Opus 5.5,並以 Gen-4.5、Seedance 2.5、GPT Image 2、Kling 及其他模型生成圖像與影片。
ComfyUI 表示,Recraft V4.1 Flash 可於 1.3 秒生成一張圖像,並稱其為市面上最快的圖像模型。選定結果其後可精修至 2048×2048 Pro 質素。
--tile 更新為 v8.1 與 v8.2 加入無縫圖案,新版 inpainting 只會改動用戶所選像素。即時模型是 Midjourney alpha 網站上的早期預覽,並非正式全面發布。
GMI Cloud 以每張圖像 $0.024 提供 Hy Image 3.5 預覽版,該公司表示此價格比 GPT Image 2 便宜 8.8 倍,比 Nano Banana Pro 便宜 5.6 倍。
OpenRouter 列出 Recraft V4.1 Flash 的價格為每張圖像 0.007 美元,生成時間為每張圖像 1.3 秒。OpenRouter 表示,輸出在攝影、人像、複雜場景、標誌及早期概念上仍保持 Recraft 的風格。
Microsoft AI 把這個速度定為每年 377 分,即榜上第二快升幅的 1.6 倍。
Microsoft AI 表示,MAI 在 10 個月內於文字轉圖像取得 283 Elo 的提升,使其圖像生成爬坡速度領先任何其他實驗室 61%,同時優化 Pareto 前沿。
OnSoloAI 表示,獨家 Hy Image3.5 預覽版支援 5 個參考及 2K,會員可免費使用兩週。騰訊 Hy 稱,其適用於短劇角色設定圖、全動態電子遊戲素材及關鍵幀。
ComfyUI 已開放 Hy Image3.5 預覽版,可用於最高 2K 的文字生成圖像及圖像生成圖像。ComfyUI 表示,在人工評估中,相對 Hy Image3.0 的勝率為 +30%。
騰訊混元表示 Hy Image3.5 預覽版已上線,支援最高 2K 的文字轉圖像及圖像轉圖像生成。騰訊雲 API 定價為每張生成圖像 $0.024,並僅在 OnSolo 及 Miora 提供兩週免費。
Sayak Paul 描述 QwenImage 2.1 如何納入 KV 快取:將固定上下文與每個去噪步驟都會改變的圖像位置分開快取。他表示後續步驟成本更低,並實測得出 2.55 倍加速。
阿里雲表示,Qwen-Image-2.1 較前代提升視覺質素,尤其在文字及人像的美學方面,並分享了文字渲染示例。
阿里雲宣布推出 Qwen-Image-2.1,一款統一的 7B 圖像生成與編輯模型,並開放權重。該公司表示,模型可原生處理 RGBA 圖層,支援最多 10 張參考圖像,並已於 GitHub、ModelScope 及 Hugging Face 上提供。
Qwen 重點介紹 Hugging Apps 於 Hugging Face Spaces 上的 Qwen-Image-2.1 即時示範,表示單一檢查點即可涵蓋生成與編輯,並可於瀏覽器中試用,無需設定。Hugging Apps 將該模型描述為 7B 參數的原生生成與編輯模型,最多可使用 10 張圖像參考。
Hugging Apps 表示,Qwen Image 2.1 是一款 7B 參數的原生圖像生成及編輯模型,最多支援 10 張圖像參考,並配備自家提示詞增強 LLM,以及與 diffusers 和 ComfyUI 的整合。該模型可於 Hugging Face Spaces 上使用。
Sayak Paul 表示 Qwen-Image-2.1 於 Diffusers 提供 Day-0 支援,並連結至 Hugging Face 上的模型。
ComfyUI 表示現已支援 Qwen-Image-2.1,並描述其為用於生成與編輯的開放權重 7B 檢查點。Qwen 引用該公告並強調 ComfyUI 的支援。
Qwen 宣布 Qwen-Image-2.1,表示這款 7B 模型統一圖像生成與編輯,權重現已開放。該公司表示,模型原生處理 RGBA 圖層,支援最多 10 張參考圖像,並提供精確局部控制。