Runway MCPがClaudeに接続し、画像と動画を生成
Runway MCPは、Claude Opus 5.5を含むClaudeに直接接続でき、Gen-4.5、Seedance 2.5、GPT Image 2、Klingなどのモデルで画像と動画を生成できる。
Runway MCPは、Claude Opus 5.5を含むClaudeに直接接続でき、Gen-4.5、Seedance 2.5、GPT Image 2、Klingなどのモデルで画像と動画を生成できる。
ComfyUIによると、Recraft V4.1 Flashは1.3秒で画像を1枚生成し、市場最速の画像モデルだという。選択した結果は、その後2048×2048のPro品質まで精細化できる。
--tileの更新はv8.1とv8.2にシームレスなパターンを追加し、新しいインペインティングはユーザーが選択したピクセルだけを変更する。リアルタイムモデルはMidjourneyのアルファサイトでの初期プレビューであり、正式リリースではない。
GMI CloudはHy Image 3.5プレビューを画像1枚あたり0.024ドルで提供している。同社によると、この料金はGPT Image 2より8.8倍、Nano Banana Proより5.6倍安い。
OpenRouterはRecraft V4.1 Flashを、画像1枚あたり0.007ドル、生成時間1.3秒で掲載している。写真、ポートレート、複雑なシーン、ロゴ、初期コンセプトでも、出力は依然としてRecraftらしい見た目だとしている。
Microsoft AIはこのペースを年377ポイント、ボード上で次に速い上昇の1.6倍としている。
Microsoft AIによると、MAIは10カ月でテキストから画像のEloを283上げ、パレートフロンティアの最適化を進めつつ、画像生成のヒルクライミング速度を他のどのラボより61%上回った。
OnSoloAIによると、独占のHy Image3.5プレビューは参照5点と2Kに対応し、Membersは2週間無料で利用できる。Tencent Hyは、ショートドラマのキャラクターシート、フルモーションのゲーム用アセット、キーフレーム向けだと説明している。
ComfyUIは、Hy Image3.5のプレビューを、最大2Kのテキストから画像および画像から画像の生成向けに利用できるようにした。ComfyUIによると、人間による評価でHy Image3.0に対する勝率は+30%だという。
Tencent Hunyuanは、Hy Image3.5プレビューが公開され、テキストから画像および画像から画像への生成が最大2Kまで対応すると述べた。Tencent Cloud APIの価格は生成画像1枚あたり$0.024で、OnSoloとMioraでのみ2週間無料と提供した。
Sayak Paulは、QwenImage 2.1におけるKVキャッシングの組み込みについて、各デノイジングステップで変化する画像位置とは別に固定コンテキストをキャッシュする方法を説明した。後のステップが安価になり、2.55倍の高速化が測定されたと述べた。
Alibaba Cloudは、Qwen-Image-2.1が前モデルと比較して視覚品質を向上させ、特にテキストとポートレートの美学において改善したと述べ、テキストレンダリングの例を共有した。
Alibaba Cloudは、オープンウェイトの統合型7B画像生成・編集モデルQwen-Image-2.1を発表した。同社によると、RGBAレイヤーをネイティブに処理し、最大10枚の参照画像に対応し、GitHub、ModelScope、Hugging Faceで利用できる。
QwenはHugging Face Spaces上のHugging AppsによるQwen-Image-2.1のライブデモを紹介し、1つのチェックポイントで生成と編集をカバーし、セットアップなしでブラウザで試せると述べた。Hugging Appsは同モデルを、最大10枚の画像参照に対応する7Bパラメータのネイティブ生成・編集モデルと説明した。
Hugging Appsによると、Qwen Image 2.1は最大10枚の画像参照を備えた7Bパラメータのネイティブ画像生成・編集モデルであり、独自のプロンプト強化LLMとdiffusersおよびComfyUIとの統合を備えています。Hugging Face Spacesで利用可能です。
Sayak Paul 氏は Qwen-Image-2.1 が Diffusers で Day-0 利用可能だと述べ、Hugging Face 上のモデルにリンクした。
ComfyUIは、Qwen-Image-2.1がサポートされるようになったと述べ、生成と編集のためのオープンウェイトの7Bチェックポイントであると説明しました。Qwenはその発表を引用し、ComfyUIのサポートを強調しました。
QwenはQwen-Image-2.1を発表し、7Bモデルが画像生成と編集を統合し、その重みが現在オープンであると述べた。同社は、RGBAレイヤーをネイティブに扱い、最大10枚の参照画像をサポートし、精密な局所制御を提供すると述べた。