Runway MCP 接入 Claude,用于图像与视频生成
Runway MCP 可以直接接入 Claude,包括 Claude Opus 5.5,并使用 Gen-4.5、Seedance 2.5、GPT Image 2、Kling 及其他模型生成图像和视频。
Runway MCP 可以直接接入 Claude,包括 Claude Opus 5.5,并使用 Gen-4.5、Seedance 2.5、GPT Image 2、Kling 及其他模型生成图像和视频。
ComfyUI 称 Recraft V4.1 Flash 可在 1.3 秒内生成一张图像,并称其为市场上最快的图像模型。选定结果随后可精修至 2048×2048 Pro 画质。
--tile 更新为 v8.1 和 v8.2 增加无缝图案,新版 inpainting 只改动用户选中的像素。实时模型目前仅在 Midjourney 的 alpha 站点作早期预览,并非完整发布。
GMI Cloud 以每张图片 0.024 美元提供 Hy Image 3.5 预览版,并称这一价格比 GPT Image 2 便宜 8.8 倍,比 Nano Banana Pro 便宜 5.6 倍。
OpenRouter 列出 Recraft V4.1 Flash 的价格为每张图像 0.007 美元,生成时间为每张图像 1.3 秒。OpenRouter 称,其输出在摄影、人像、复杂场景、标志和早期概念方面仍保持 Recraft 的风格。
Microsoft AI 称这一速度为每年 377 分,相当于榜上第二快升幅的 1.6 倍。
Microsoft AI 称,MAI 在 10 个月内文生图 Elo 提升 283 分,图像生成爬坡速度比任何其他实验室快 61%,同时在优化帕累托前沿。
OnSoloAI 表示,独家 Hy Image3.5 预览版支持 5 个参考和 2K,会员可免费使用两周。Tencent Hy 称其面向短剧角色设定表、全动态游戏素材和关键帧。
ComfyUI 已开放 Hy Image3.5 预览版,可用于最高 2K 的文生图和图生图。ComfyUI 称,该模型在人工评测中相对 Hy Image3.0 的胜率为 +30%。
腾讯混元表示 Hy Image3.5 预览版已上线,支持最高 2K 的文生图和图生图。腾讯云 API 定价为每张生成图片 $0.024,并仅在 OnSolo 和 Miora 上提供两周免费。
Sayak Paul 介绍了 QwenImage 2.1 如何融入 KV 缓存:将固定上下文与每一步去噪都会变化的图像位置分开缓存。他表示后续步骤成本更低,并测得 2.55 倍加速。
阿里云表示,Qwen-Image-2.1 相较前代提升了视觉质量,尤其在文字和人像的美学表现方面,并分享了文字渲染示例。
阿里云宣布推出 Qwen-Image-2.1,这是一款开放权重的统一 7B 图像生成与编辑模型。该公司表示,该模型可原生处理 RGBA 图层,最多支持 10 张参考图像,并已在 GitHub、ModelScope 和 Hugging Face 上提供。
Qwen 重点介绍了 Hugging Apps 在 Hugging Face Spaces 上的 Qwen-Image-2.1 实时演示,称单个检查点即可覆盖生成与编辑,并可在浏览器中试用,无需任何设置。Hugging Apps 将该模型描述为 7B 参数的原生生成与编辑模型,最多支持 10 张图像参考。
Hugging Apps 表示,Qwen Image 2.1 是一款 7B 参数的原生图像生成与编辑模型,最多支持 10 张参考图像,配备自有的提示词增强大语言模型,并已集成 diffusers 和 ComfyUI。该模型可在 Hugging Face Spaces 上使用。
Sayak Paul 表示 Qwen-Image-2.1 已在 Diffusers 中实现 Day-0 可用,并链接到 Hugging Face 上的该模型。
ComfyUI 表示现已支持 Qwen-Image-2.1,称其为一个用于生成与编辑的开放权重 7B 检查点。Qwen 引用了该公告并强调了 ComfyUI 的支持。
Qwen 宣布推出 Qwen-Image-2.1,称该 7B 模型统一了图像生成与编辑,且权重现已开源。该公司表示,该模型原生处理 RGBA 图层,支持最多 10 张参考图像,并提供精确的局部控制。