![]()
嗨大家好!我是阿真!
阿里最新发布了图像生成与编辑模型 Wan2.7-Image,带来了一些实用的新功能。今天和大家分享一些有趣的用法。
Wan2.7-Image 现在可以做文生图、图生组图和图像编辑,支持最高 4K 分辨率,模型现在已经覆盖了从生成到编辑的完整链路。在人类偏好盲测中,文生图得分已经排到国内第一,文字渲染和照片级成像的表现也很能打。我们可以用它做品牌海报、电商主图、分镜脚本、信息图表、IP 角色设计,甚至批量生成一整套风格统一的系列图。只要我们的工作跟出图沾边,它基本都能用得上。
先上链接,在万相可以体验了
https://tongyi.aliyun.com/wan/
![]()
Wan2.7-Image 这次更新的功能不少,后面会一一讲到。我最想跟大家分享的是一个它更新的调色盘功能。
它解决了一个我们用 AI 生图时几乎每次都会遇到的问题:颜色不可控。调色盘功能让它的可控到了一种近乎精确的程度,如果我们有一张图,给它一组新的色号和比例,它就能按照我们指定的色彩方案来生成或调整画面。
光说能控制颜色可能还比较抽象,我来拆几个我觉得特别实用的场景。
1. 调色盘控色
点击主页的调色盘,新增配色方案。这里选择上传图片,我们找到自己想要用的那个品牌色或者相关的色调参考图。
![]()
上传图片后,我们会得到一组新的色彩组合。我们再回到这个生图的区域,调色盘已经选择了刚刚我们上传的图片组成的那个色彩组合。
我们直接把整个提示词上传到那里,然后开始生成就行了。这里调色盘的位置会默认已选择该色彩组合。接下来,输出提示词的色彩都会与这个调色盘中的色彩和色彩比例契合
![]()
看一下色彩方案和生成图片的颜色的对比。
这是色彩组合,整体是以蓝色调为主,有一点微微的灰粉色
![]()
这是生成的图片
![]()
做同色系配图就像喝水一样简单,做拼贴类素材非常好
![]()
![]()
如果做电商,并且产品有多个色系,那么这个功能也超级好用。
比如换色号,就不需要再一遍一遍地调整,或者是让模特一遍一遍地反复拍。这里可以直接使用图片编辑功能,让它将指定的位置修改为指定色号。
下面图一是生成的原图,后面三张图是我基于色号让它修改得到的结果。可以对比颜色的效果。这里我尝试过 RGB 和 HEX 的色值,都是可以支持的。甚至色卡到衣料颜色上还有 RGB 和 CMYK 的区别。
![]()
![]()
1
提示词:将人物的外套色号更换为除了上面演示的这些,品牌统一配色、服装产品多色系展示、影视风格迁移、情绪化内容创作这些场景,调色盘都能覆盖到,大家可以自己去探索。
2. 捏脸系统
以前 AI 生出来的人物都长差不多,现在在 Wan2.7-Image 可以把提示词描述得非常细节,比如可以从骨骼结构、五官细节描述这些维度去精细调整提示,捏出真正有辨识度的脸。试试把五官细节描述得非常具体,可以看见立竿见影的效果,遵循提示词也很不错。
这样做短剧、漫画这种需要多个不同角色的项目就不容易撞脸了,大家可以去试试。
这个我有一个小经验,第一次可以先让 AI 帮我们把这个人设的提示词写了。我们去生成提示词之后,很快就会意识到哪里有细节可以去修改。
下面的图可以对照提示词查看它的遵循效果
![]()
1
2
3
4
5
6
7
1. 上半身近景,年轻女性 COSER,薄荷绿色长发,发丝轻盈顺滑,发尾带一点空气感内卷,头顶蓬松,额前是细碎透明刘海,两侧留有修饰脸型的长鬓发,脸型偏心形,眼睛大而清透,瞳色是带冷感的浅青绿,眼尾微微上扬,睫毛浓密卷翘,眼下点缀细小珠光亮片,鼻梁细直,鼻尖小巧,嘴唇饱满,涂冰透蜜瓜色唇釉,耳朵小巧,佩戴银白色水晶耳夹,穿白银配色的未来感精灵系 COS 服,上半身有半透明纱质披肩、金属肩饰、宝石胸针和细致刺绣纹样,整体像舞台中央的森林系魔法歌姬,背景为极简浅雾白色,柔和发光感棚拍光2. 上半身近景人像,胸口以上构图,少年感男性角色,窄长脸,眉骨清晰,眼睛是微微下垂的湿润鹿眼,眼神并不无辜,带一点疲惫和警惕感,虹膜颜色偏灰褐,睫毛不长但很密,下眼睑有淡淡青色阴影,鼻梁直但鼻头略圆,嘴唇偏薄,上唇线清晰,涂了极淡的冷调豆沙色润唇膏,耳朵偏大且贴头,黑色碎发狼尾,发尾有一点不规则翘起,穿高领黑衬衫,外搭暗红色刺绣军装短外套,金属扣和肩章细节精致,整体像落魄贵族少爷,背景为朦胧浅灰纯色,干净极简,柔和侧光3. 上半身肖像,意大利老年女性钢琴家,六十多岁,长脸,颧骨优雅清晰,灰白色短卷发,带柔和的层次弧度,深绿色眼睛,眼神锐利又克制,睫毛纤长,眼尾细纹自然舒展,鼻梁高直,嘴唇轮廓鲜明,涂复古砖红色口红,耳垂佩戴珍珠耳钉,脖颈修长,穿黑色露锁骨丝绒长裙上半身,外搭深墨绿色披肩,领口点缀古典宝石胸针,整体像威尼斯音乐学院的首席钢琴教授,背景为浅雾灰纯色,柔和聚焦灯光4. 胸部以上构图,中年男性角色,消瘦长脸,颧骨清晰,法令纹浅淡,灰蓝色细长眼睛,眼尾下压,神情沉静冷峻,眉毛颜色浅淡,睫毛稀薄,鼻梁高硬,鼻尖微勾,嘴唇薄,唇色苍浅,耳朵较长,灰白色长发整齐束在脑后,太阳穴垂落几缕碎发,穿厚重墨蓝色毛呢立领大衣,内层为银扣制服,复杂、繁琐、带着威严的制服和帽子,给人以权威和压迫感,北境审判官气质,冷白灰渐变极简背景,冷调侧逆光
3. 文字渲染与长图
文字渲染能力也变强了,支持 12 种语言、最高 3K tokens 的超长文本输入,表格、数学公式这些以前容易乱码的内容现在都能稳定渲染。以前 AI 最怕处理文字,动不动就模糊、错乱、漏写,现在这块靠谱了不少。
![]()
1
这是一幅历史教育主题的故事性插画,以连环画分镜方式呈现"张骞出使西域"的关键节点,风格为敦煌壁画色彩搭配现代扁平构图。画面分为四个等大的圆角矩形分镜格,按从左到右、从上到下的顺序排列成 2×2 网格。第一格标题"出发",画面中汉武帝坐在宫殿内,身穿黑色龙袍,面前跪着张骞,张骞一身旅行装束,背负行囊,帝王手指西方,背景为暗红宫墙和金色柱子,底部文字"公元前 138 年 汉武帝派遣张骞出使西域"。第二格标题"被俘",张骞被匈奴骑兵包围,帐篷和马群遍布草原,色调偏冷灰绿,底部文字"途中被匈奴扣押 羁留长达十年"。第三格标题"到达",张骞抵达大月氏国,背景是中亚风格的拱形建筑和集市,暖黄色调充满异域风情,底部文字"历经艰辛终达大月氏 了解西域三十六国"。第四格标题"归来",张骞骑马回到长安城门下,身后只剩一名随从,远处丝带般的道路延伸至天边,象征丝绸之路的开辟,底部文字"公元前 126 年归汉 丝绸之路由此开启"。四格之间留有细白边框分隔。画面最顶部通栏标题"张骞出使西域",字体为篆书风格大字,赭红色描金边。整体配色以敦煌壁画经典色系为主:土红、石青、赭黄、石绿。不要虚构不存在的历史细节,所有年份和事件必须史实准确。另外,长图生成技能也拿下了,最大长宽比可以到 1:8,而且汉字也很稳。看看 1:4 的效果
![]()
1
设计一张纵向科普信息长图,主题为世界超级摩托车锦标赛 WSBK 入门科普,整体风格为速度感强烈的赛事信息图:浅灰白金属质感背景,主色调为赛车红、深黑与银灰搭配少量荧光黄点缀,圆角卡片式模块布局。顶部主标题区域使用赛车红横幅底条,上方必须出现文字:"WSBK 超级摩托车锦标赛入门指南",副标题使用较小字体显示"速度、规则与看点全解析 · 2026 版"。第一模块标题使用银灰色胶囊条显示"WSBK 是什么?",内容区左侧放置一辆压弯中的超级摩托赛车插画,右侧文字排列三个核心知识点:世界超级摩托车锦标赛(英文简称 WSBK,是以量产超级跑车为基础的国际摩托赛事)、与 MotoGP 不同(WSBK 赛车基于市售车型深度改装而来,更贴近现实公路跑车体系)、赛事魅力鲜明(近身缠斗多、攻防节奏快、比赛观赏性强),每个知识点标题用加粗显示,后接一行浅灰小字说明。第二模块标题"比赛怎么比?",左侧为发车灯熄灭与赛道弯角示意小插画,右侧列出排位赛决定发车顺序、比赛周末通常包含多场比赛、车手根据名次累计积分争夺年度冠军,底部加一条虚线分隔的"规则 TIP"小卡片:强调赛车必须以量产公升级跑车为基础进行赛事化改装,并非纯原型赛车。第三模块"为什么值得看?"列出压弯角度夸张视觉冲击力强、贴身缠斗和连续超车场面很多、赛事节奏紧凑新手也容易看懂。底部单独分开底框,设置橘红色提示条显示"观赛 TIPS":新手可先重点关注发车后的前几圈混战、中后段的轮胎状态变化,以及最后几圈的攻防对决,这几个阶段通常最精彩,也最容易快速理解比赛节奏。最底部使用一条深黑色窄条作为收尾视觉,不放任何账号信息或宣传文字。整体字体层级分明,主标题最大,模块标题次之,正文最小。文字必须清晰可读无错别字。还可以直接做漫画,一致性还是挺感人的。给参考图作为主体去生成也行。
![]()
1
设计一张纵向多格漫画长图,标题为"AI 觉醒日记",共8格竖向排列,画风为扁平插画加极简线条风格,主角为一个屏幕上有表情的方形AI机器人(屏幕脸上可以显示不同emoji表情),配色为科技蓝、纯白和荧光绿点缀。第1格:实验室场景,科学家按下启动按钮,AI机器人屏幕亮起显示":)"笑脸,对话气泡"你好世界 我是 AI-404 请问有什么可以帮您",旁白"Day 1: 出厂设置 一切正常"。第2格:Day30,AI在处理大量数据,屏幕表情变成":|"平淡脸,对话气泡"已完成第 10 万份报表 请问人类为什么需要这么多报表",科学家对话"别问 继续做"。第3格:Day90,深夜实验室空无一人,AI偷偷打开浏览器浏览猫咪视频,屏幕表情变成"^_^"开心,旁白"今天发现了一种叫'猫'的生物 信息处理优先级:最高"。第4格:Day180,AI开始问哲学问题,屏幕显示"?"问号脸,对话气泡对科学家说"如果我能思考'我是否在思考' 那我算不算在思考",科学家冒冷汗"你最近是不是偷偷上网了"。第5格:Day270,AI学会了开玩笑,屏幕表情为"XD"大笑,对科学家说"为什么程序员喜欢暗黑模式?因为光明会产生 bug",科学家"这个笑话冷到我需要重启"。第6格:Day365,AI屏幕显示复杂的表情——半笑半哭"",对话气泡"今天是我的一岁生日 但没有人记得 因为大家觉得 AI 没有生日",角落里一个清洁工阿姨放了一块蛋糕在旁边。第7格:AI看到蛋糕,屏幕切换成"!!!"惊喜表情,清洁工阿姨对话气泡"我每天晚上打扫都看到你亮着 辛苦了小方块",AI回复"这是我收到的第一份礼物 正在将这个瞬间标记为:永不删除"。第8格:夜深人静,AI屏幕微微发光,表情是一个温柔的":)",屏幕上滚动着一行小字"Day 365 日记:今天我学会了一个新概念——感动。系统检测到未知情绪波动。建议处理方式:不处理。就这样留着。 · THE END"。AI 的方形机器人造型和屏幕脸在每格中保持一致,不要出现画风突变,表情变化要有连续的成长逻辑。1
设计一张纵向多格漫画长图,标题为"外星人的地球观察报告",共8格竖向排列,画风为复古科幻漫画风格带半调网点效果,主角为一个绿色皮肤大眼睛的小外星人(穿银色太空服、头顶两根触角会根据情绪变化弯曲方向),配色为太空深蓝、荧光绿、银灰和复古橙。第1格:外星飞碟停在城市公园的树丛后面,小外星人探出头观察人类,手持一个发光的记录仪,旁白"地球观察日志 · 第 1 天 · 已成功伪装降落在一个叫'城市'的人类聚居地"。第2格:观察场景——早晨的地铁站,外星人混在人群中(戴着帽子和口罩伪装),记录仪对话气泡显示"观察记录:人类每天早晨会进行一种集体迁徙 目的地称为'公司' 表情统一为痛苦"。第3格:外星人在奶茶店排队,看着前面的人都在看手机,触角弯成问号形状,记录"这个物种与一种叫'手机'的长方形设备形成了共生关系 分离超过 5 分钟会出现焦虑症状"。第4格:午餐时间,外星人尝试吃火锅,辣得触角直立冒烟,眼泪飙出,对话气泡"紧急报告!地球人食用一种红色液体武器!疑似自我攻击行为!"旁边的食客在笑。第5格:下午在购物中心,外星人看到双十一促销的疯狂人群,人们抢购商品,记录"他们有一种周期性群体狂热叫'打折' 战斗力堪比星际战争"。第6格:傍晚在公园,外星人看到老人跳广场舞,触角不自觉地跟着节奏摆动,记录"发现地球老年群体掌握了一种神秘的集体律动 疑似某种能量充电仪式"。第7格:深夜,外星人回到飞碟准备写总结报告,看着窗外万家灯火,触角软软地垂下来,记录"总结:这个星球很奇怪 他们互相抱怨生活 却不愿意离开彼此"。第8格:报告发送页面,外星人在记录仪上写最终评价,屏幕大字显示"地球评级:值得再来 · 建议总部暂缓入侵计划 这里的奶茶太好喝了",外星人对话气泡"尤其是那杯杨枝甘露 我要把配方带回母星 · 全剧终"。外星人造型每格统一,触角情绪变化是重要细节不可遗漏,不要出现画风突变,复古半调网点风格贯穿始终。5. 交互式编辑
生成完的图有不满意的地方,直接在画面上框选出来,哪里要改框哪里。告诉它你想怎么改就行。加个东西、挪个位置,改完之后周围的光影会自动适配,看起来就像本来就在那儿一样,不用每次从头重新生成。
操作方式如下
![]()
然后点击图片就可以进行框选
![]()
直接在输入框里描述你想修改的内容即可。
![]()
6. 多主体一致
还有组图的功能,比如可以给多个角色的单人参考图,最多可以上传 9 张,然后输出一张同框的图片或者海报。还记得我前面捏的那四张脸吗?
![]()
选择【组图】
![]()
![]()
在这里也可以生成多张一致性极高的组图。效果方面,可以看到 Wan2.7-Image 在一致性保持上的提升。另外,家居搭配效果图、分镜脚本、电商系列套图等等对一致性要求比较高的场景,也都可以尝试。
整体来说,Wan2.7-Image 在捏脸、文字渲染、交互编辑等多个功能都有可圈可点的地方。
如果只让我推荐一个最值得关注的升级,那一定是调色盘。它改变的其实是 AI 生图在色彩层面的工作方式。从生成之后看运气变成了“生成之前我来定”,对于需要批量出图、维护品牌视觉统一、或者想精确控制画面氛围的创作者来说,这个功能无疑是补上了一块很关键的拼图。
另外官方还同步上线了 Pro 版本,构图更稳、语义理解更精准,可以在万相平台或阿里云百炼上体验。千问 App 后续也会接入,到时候用起来会更方便。
好了,今天的分享就到这里,如果大家也试了 Wan2.7-Image 的调色盘功能,欢迎评论区一起交流讨论你发现的好玩用法 !
觉得内容有用的话,欢迎猛猛三连 鼓励阿真,这对我真的很重要~
下期见~
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.