阿里巴巴的Wan2.7图像AI能生成定制人脸并撰写文章
今天,阿里巴巴正式发布了其用于图像生成与编辑的统一大模型——Wan2.7-Image。该模型不仅在视觉质量上实现了质的飞跃,还通过全面的能力升级,克服了传统AI图像生成中的“千篇一律的脸”和“提示词不匹配”等局限。
告别AI生成脸:迈入“一人一脸”时代
Wan2.7-Image 显著增强了虚拟人物定制功能。用户可以从骨骼结构、眼睛到细微的面部特征进行全方位定制,精准控制椭圆脸、凤眼或深邃眼窝等具体特征。这一进步突破了以往 AI 人像机械化的千篇一律,实现了真正的个性化表达。

“调色板”功能与“印刷级”文字渲染
在艺术表达方面,该模型现已支持“调色板”功能。用户只需单击一下,即可从参考图像(如马蒂斯的红色系列或梵高的黄色系列)中提取色彩组合,并将其精准应用到新创作中。 此外,Wan2.7-Image 在长文本渲染方面表现卓越,支持长达 3K 令牌的输入。它能够稳定输出包含复杂公式和表格的整页 A4 内容,在 12 种支持语言中均达到印刷级质量标准。

交互式编辑与多主题一致性
该模型拥有强大的交互式编辑能力,支持通过精准选取对元素进行对齐、移动或替换。例如,用户可选取图像中的字符交换位置,或将冰块替换为水果,实现像素级控制。同时,该模型支持多达9张图像间的跨主题一致性,在生成AI女团或家具套装时能保持统一的风格与特征。

核心技术突破与行业应用
Wan2.7-Image采用领先的生成与理解统一架构,在共享的潜在空间内实现语义映射。这意味着模型不再仅仅通过猜测文本来匹配像素,而是具备了基础的语义理解能力。该模型与Wan2.7-Image-pro版本同步发布,后者提供了更稳定的构图和更精准的理解能力。

该模型目前已广泛应用于短视频制作(一人分饰多角)、电商广告(一张模特图多场景适用)、教育、科研及社交娱乐等领域。用户可通过阿里云白莲平台 调用API,或直接在万象官网 体验。
相关文章
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
尽管营收未达预期,OpenAI与Anthropic仍在争夺市场份额
尽管近期有报道称OpenAI未达营收目标,给本周二的科技股带来压力,但私营人工智能实验室的投资者仍表现坚韧。经验丰富的投资者已确认,尽管媒体报道负面,他们仍不会减少投资。分析师认为当前的人工智能竞赛仍处于早期阶段,因此不会出现“赢家通吃”的局面。尽管高昂的计算成本给营收带来压力,但实验室可通过提高订阅费来提升盈利能力。行业格局正发生微妙变化与OpenAI不同,其竞争对手Anthropic获得了强有
加利福尼亚州自动驾驶合规:罚单、地理围栏和100万英里的新时代
Guident公司在南佛罗里达州运营一辆AuveTech自动驾驶班车,利用其远程监控技术管理西棕榈滩的一条4英里路线和博卡拉顿的一条1英里路线。| 图片来源:Guident加利福尼亚州正在重新定义无人驾驶车辆的监管格局,正逐渐摆脱科技行业“快速行动,打破常规”的思维模式,转向严格的问责制和严苛的行驶里程要求。Guident执行董事长兼首席执行官哈罗德·布劳恩(Harold Braun)在《机器人报
相关专题推荐
评论 (0)
0/500
今天,阿里巴巴正式发布了其用于图像生成与编辑的统一大模型——Wan2.7-Image。该模型不仅在视觉质量上实现了质的飞跃,还通过全面的能力升级,克服了传统AI图像生成中的“千篇一律的脸”和“提示词不匹配”等局限。
告别AI生成脸:迈入“一人一脸”时代
Wan2.7-Image 显著增强了虚拟人物定制功能。用户可以从骨骼结构、眼睛到细微的面部特征进行全方位定制,精准控制椭圆脸、凤眼或深邃眼窝等具体特征。这一进步突破了以往 AI 人像机械化的千篇一律,实现了真正的个性化表达。

“调色板”功能与“印刷级”文字渲染
在艺术表达方面,该模型现已支持“调色板”功能。用户只需单击一下,即可从参考图像(如马蒂斯的红色系列或梵高的黄色系列)中提取色彩组合,并将其精准应用到新创作中。 此外,Wan2.7-Image 在长文本渲染方面表现卓越,支持长达 3K 令牌的输入。它能够稳定输出包含复杂公式和表格的整页 A4 内容,在 12 种支持语言中均达到印刷级质量标准。

交互式编辑与多主题一致性
该模型拥有强大的交互式编辑能力,支持通过精准选取对元素进行对齐、移动或替换。例如,用户可选取图像中的字符交换位置,或将冰块替换为水果,实现像素级控制。同时,该模型支持多达9张图像间的跨主题一致性,在生成AI女团或家具套装时能保持统一的风格与特征。

核心技术突破与行业应用
Wan2.7-Image采用领先的生成与理解统一架构,在共享的潜在空间内实现语义映射。这意味着模型不再仅仅通过猜测文本来匹配像素,而是具备了基础的语义理解能力。该模型与Wan2.7-Image-pro版本同步发布,后者提供了更稳定的构图和更精准的理解能力。

该模型目前已广泛应用于短视频制作(一人分饰多角)、电商广告(一张模特图多场景适用)、教育、科研及社交娱乐等领域。用户可通过
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
尽管营收未达预期,OpenAI与Anthropic仍在争夺市场份额
尽管近期有报道称OpenAI未达营收目标,给本周二的科技股带来压力,但私营人工智能实验室的投资者仍表现坚韧。经验丰富的投资者已确认,尽管媒体报道负面,他们仍不会减少投资。分析师认为当前的人工智能竞赛仍处于早期阶段,因此不会出现“赢家通吃”的局面。尽管高昂的计算成本给营收带来压力,但实验室可通过提高订阅费来提升盈利能力。行业格局正发生微妙变化与OpenAI不同,其竞争对手Anthropic获得了强有





首页






