アリババ、汎用AI顔の時代を終わらせる「Wan2.7-Image」を発表
アリババの公式大規模モデルチームは本日、画像生成・編集を統合したモデル「Wan2.7-Image」をリリースしました。このモデルは、ポートレートのカスタマイズ、色調制御、長文のレンダリングにおいて、前世代モデルから質的な飛躍を遂げており、AI生成画像によく見られる「画一的な均一性」を克服することを目指しています。
本モデルは現在、Alibaba Cloud BaiLianプラットフォームのAPI経由で利用可能となっており、WanXiangウェブサイトでも一般公開トライアルが開始されています。

主な機能強化:仮想「顔の彫刻」と精密な色制御
Wan2.7-Imageは、クリエイティブな可能性を大幅に広げる、業界をリードする独自の機能をいくつか導入しています:
被写体ごとにユニークな顔:強化された仮想「顔の彫刻」機能を備えています。ユーザーはテキストプロンプトを通じて骨格、目の形(アーモンドアイや鳳眼など)、その他の顔のディテールを精密に制御でき、画一的なAI生成顔を効果的に排除します。
精密なカラーパレット:高度な色制御機能を新たに搭載しました。ユーザーは参照画像から色の比率を抽出し、ゴッホの鮮やかな黄色やピカソのクールな青といった特定の色調を、新しい作品に正確に再現することができます。
3Kトークン対応の超長文生成:AIテキスト生成における一般的な課題を解決し、最大12言語に対応しています。このモデルは、A4用紙1枚分に及ぶ複雑なテキスト、表、数式を、印刷可能な品質で生成できます。
画像編集の分野では、Wan2.7-Imageが「インタラクティブ編集」機能を初搭載しました。ユーザーは特定の領域を選択するだけで、要素の追加、配置、移動、さらにはピクセル単位での論理置換(シーンの元の照明を完璧に保ちながら、氷の立方体を果物に置き換えるなど)を行うことができます。

さらに、このモデルは最大12枚の画像からなる一貫性のあるセットの生成をサポートしており、異なるシーン間でもスタイルや被写体の特徴において高い整合性を維持します。これは、集合写真や統一感のある製品組み合わせの生成に最適です。
Ali氏は、Wan2.7-Imageが生成と理解の両方に統一されたアーキテクチャを採用していると説明しています。共有された潜在空間内で意味論的マッピングを実現することで、このモデルは単なるピクセルパターンの推測を超え、意味論に対する真の根本的な理解を確立しています。
2026年のビジュアル制作シーンへのリリースを控えたWan2.7-Imageは、AI画像生成における転換点を示しています。それは「ランダムなカード引き」から「産業グレード」の精密制御への移行です。この高忠実度の編集機能は、映画のストーリーボード、EC広告、ソーシャルメディアのコンテンツ変換など、プロフェッショナルなコンテンツ制作の参入障壁を劇的に引き下げるものと期待されています。
関連記事
DeepMindのCEOハサビス氏:1日6時間睡眠し、通常午前1時頃に活力を感じます。
フォーチュンは最近、Google DeepMindのCEOであるデミス・ハサビスへのインタビューを掲載し、彼の休息と生産性に対する非伝統的なアプローチを明らかにした。ハサビスは、睡眠時間が非常に短いことを明かし、覚醒時間を2つの明確な作業ブロックに構造化していると語った。彼の睡眠習慣について、ハサビスは「6時間の睡眠を目標としているが、私の習慣は典型的ではない。一日中効果的に機能できる」と述べた。彼は、6時間未満の睡眠は脳の健康に悪影響を及ぼすことを強調した。2010年にDeepMindを共
OpenAIとAnthropic、収益の伸び悩みにもかかわらず市場シェア争いを繰り広げる
OpenAIが収益目標を達成できなかったとする最近の報道を受け、今週火曜日にハイテク株に売り圧力が生じたにもかかわらず、AI研究機関への民間投資家は依然として堅調だ。経験豊富な出資者たちは、メディアによる否定的な報道にもかかわらず、投資額を減らすつもりはないことを明らかにしている。アナリストらは、現在のAI競争はまだ初期段階にあると見ており、「勝者総取り」という結末はあり得ないと見ている。高いコン
カリフォルニア州の自動運転車規制:違反切符、ジオフェンス、そして100万マイルという新たな時代
Guident社は南フロリダでAuveTechのシャトルを運行しており、同社の遠隔監視技術を活用して、ウェストパームビーチでの4マイルのルートとボカラトンでの1マイルのルートを管理している。 | 提供:Guidentカリフォルニア州は、自動運転車の規制環境を再定義しつつあり、テクノロジー業界の「迅速に動き、失敗を恐れない」という考え方から、厳格な説明責任と厳しい走行距離要件へと移行している。Gui
関連特集おすすめ
コメント (0)
0/500
アリババの公式大規模モデルチームは本日、画像生成・編集を統合したモデル「Wan2.7-Image」をリリースしました。このモデルは、ポートレートのカスタマイズ、色調制御、長文のレンダリングにおいて、前世代モデルから質的な飛躍を遂げており、AI生成画像によく見られる「画一的な均一性」を克服することを目指しています。
本モデルは現在、Alibaba Cloud BaiLianプラットフォームのAPI経由で利用可能となっており、WanXiangウェブサイトでも一般公開トライアルが開始されています。

主な機能強化:仮想「顔の彫刻」と精密な色制御
Wan2.7-Imageは、クリエイティブな可能性を大幅に広げる、業界をリードする独自の機能をいくつか導入しています:
被写体ごとにユニークな顔:強化された仮想「顔の彫刻」機能を備えています。ユーザーはテキストプロンプトを通じて骨格、目の形(アーモンドアイや鳳眼など)、その他の顔のディテールを精密に制御でき、画一的なAI生成顔を効果的に排除します。
精密なカラーパレット:高度な色制御機能を新たに搭載しました。ユーザーは参照画像から色の比率を抽出し、ゴッホの鮮やかな黄色やピカソのクールな青といった特定の色調を、新しい作品に正確に再現することができます。
3Kトークン対応の超長文生成:AIテキスト生成における一般的な課題を解決し、最大12言語に対応しています。このモデルは、A4用紙1枚分に及ぶ複雑なテキスト、表、数式を、印刷可能な品質で生成できます。
画像編集の分野では、Wan2.7-Imageが「インタラクティブ編集」機能を初搭載しました。ユーザーは特定の領域を選択するだけで、要素の追加、配置、移動、さらにはピクセル単位での論理置換(シーンの元の照明を完璧に保ちながら、氷の立方体を果物に置き換えるなど)を行うことができます。

さらに、このモデルは最大12枚の画像からなる一貫性のあるセットの生成をサポートしており、異なるシーン間でもスタイルや被写体の特徴において高い整合性を維持します。これは、集合写真や統一感のある製品組み合わせの生成に最適です。
Ali氏は、Wan2.7-Imageが生成と理解の両方に統一されたアーキテクチャを採用していると説明しています。共有された潜在空間内で意味論的マッピングを実現することで、このモデルは単なるピクセルパターンの推測を超え、意味論に対する真の根本的な理解を確立しています。
2026年のビジュアル制作シーンへのリリースを控えたWan2.7-Imageは、AI画像生成における転換点を示しています。それは「ランダムなカード引き」から「産業グレード」の精密制御への移行です。この高忠実度の編集機能は、映画のストーリーボード、EC広告、ソーシャルメディアのコンテンツ変換など、プロフェッショナルなコンテンツ制作の参入障壁を劇的に引き下げるものと期待されています。
DeepMindのCEOハサビス氏:1日6時間睡眠し、通常午前1時頃に活力を感じます。
フォーチュンは最近、Google DeepMindのCEOであるデミス・ハサビスへのインタビューを掲載し、彼の休息と生産性に対する非伝統的なアプローチを明らかにした。ハサビスは、睡眠時間が非常に短いことを明かし、覚醒時間を2つの明確な作業ブロックに構造化していると語った。彼の睡眠習慣について、ハサビスは「6時間の睡眠を目標としているが、私の習慣は典型的ではない。一日中効果的に機能できる」と述べた。彼は、6時間未満の睡眠は脳の健康に悪影響を及ぼすことを強調した。2010年にDeepMindを共
OpenAIとAnthropic、収益の伸び悩みにもかかわらず市場シェア争いを繰り広げる
OpenAIが収益目標を達成できなかったとする最近の報道を受け、今週火曜日にハイテク株に売り圧力が生じたにもかかわらず、AI研究機関への民間投資家は依然として堅調だ。経験豊富な出資者たちは、メディアによる否定的な報道にもかかわらず、投資額を減らすつもりはないことを明らかにしている。アナリストらは、現在のAI競争はまだ初期段階にあると見ており、「勝者総取り」という結末はあり得ないと見ている。高いコン





家






