![]()
上面这张图是Lovart画的,一次出图没返工。它说的也正好是我这篇想讲的事:好的设计不是给你一个答案,是把候选摆出来让你自己挑。
我的公众号封面、产品宣传物料、给品牌方交的视觉方案,有相当一部分是在Lovart的画布上做的。所以每次写它,评论区总有人问同一件事:我打不开,怎么办。
这个问题现在没了。Lovart出了正宗的国内版,直接访问:
https://www.lovart.art/
当然,只是出个国内版也没什么好说的,换个域名的事。我坐下来测了大半天,是因为他们这一版有两个升级挺值得说,放在一起看,算是把护城河又挖深了一截。
一个叫灵感采集,一个Chrome插件,你在小红书、淘宝、亚马逊、Instagram上看到任何一张顺眼的图,悬停一下就直接收进Lovart。
![]()
另一个是skill。广场上有一百来个专业skill,更关键的是它开了导入口,你在Claude Code、Codex里写的skill,可以原样拖进去用。
![]()
这两件事看起来不相干,其实是一头一尾。
一、灵感采集
装的方式有两条路,第二条我觉得挺贴心的:Chrome应用商店进不去的人,可以直接下zip手动装,他们专门留了这条路。
![]()
这种细节能想到,说明是真的在做国内版,没有把海外版翻译一遍挂个域名了事。
小红书这条路是找审美
我现在看到的好东西大部分来自小红书,那上面有大量真在做商业设计的人,在发自己刚交付的稿。
前几天刷到一张体育海报,做萨巴伦卡爆冷出局的,构图挺利落:上半部分是压暗的蓝调人物,下半部分用一道撕纸边压着标题层级(作者是小红书上的Tennis Daily)。
悬停,收藏到Lovart,两秒钟。
回到Lovart,这张图已经躺在灵感采集那一栏里了,我直接@它:
![]()
说了一句:
帮我用参考这个海报风格做一个主题叫:Lovart.art 正式发布 国内轻松访问 的3:4海报,上面的人物形象你可以重新生成一个很有创意的女性设计师形象
左边是参考,右边是它出的东西:
![]()
撕纸边、蓝底、大字标题层级,参考图的结构完整继承了,人物换成一个戴眼镜的女设计师,背景里的东西也换成了设计相关的元素。它自己在对话里解释了一遍取舍:
我参考了你提供的体育海报风格:上方是纯色背景衬托的人物主体,下方采用撕纸质感的浅色区域承载标题层级。文案按你要求放上了「Lovart.art 正式发布」和「国内轻松访问」,人物重新生成了一位有艺术气质的女性设计师形象,整体保留了参考图强烈的视觉对比和现代活动海报的排版感。
![]()
从看到图到拿到成品,中间省掉的是「下载、找文件、上传」这一趟,单看不多,但其实很多产品体验都是藏在这让你顺手一做,少点一步,两步的细节里。
电商场景的灵感采集
插件在亚马逊上一样生效,悬停就出收藏按钮:
![]()
做跨境电商的人上亚马逊,看的是别人的主图怎么排、卖点标在第几张、A+页面用什么顺序讲产品。好不好看反而是次要的。一个listing七八张主图加一整页A+,手工存一遍要点十几次。
我拿一个真实的竞品试了,LitONES的桌面视频会议补光灯,五十美元上下,4.4星七百多条评价,卖点写着CRI 97.8、三档色温、金属底座、高度可调:
![]()
把它的主图组收进来当参考,然后我给了Lovart一个真实的活,假设我要给自己做一款补光灯上架亚马逊。这个假设对我来说不算离谱,我2024年做过一个叫小猫补光灯的App,在App Store付费总榜当过一段时间的第一,做的就是给女生拍照补光这件事,只不过是软件版。
需求是这么给的:参考这几张竞品图的拍摄和排版思路,做一套自己的listing主图,品牌叫小猫补光灯Kitty Light,卖点是CRI 97+、3000K到6500K三档色温、金属底座、360度旋转灯头,主打给做线上会议和录教程视频的人用。
它没有立刻开画,先反过来问了我三件事:目标站点是哪个(这决定文案用什么语言、按哪边的合规写)、要几张listing图、有没有竞品参考图。我答美国站、7张、有。
![]()
左边那一列能看到它的工作顺序:技能加载完成、技能文件读取完成,然后才开始想。
它没有直接开始画图,先出了三张视觉系统板,把整套图的调子、场景、道具、打光、字体、版式一次定完:
![]()
![]()
定完调子,剩下的是一整套,不是一张。白底主图、场景图、配件清单、功能标注、色温对比、卖点图,一次全出来了:
![]()
顺带连品牌标志也一起给了:
![]()
白底、产品居中、右侧卖点排版,符合亚马逊主图那套规范。我特意去数了一遍上面的英文,CRI 97+、True Color、Natural skin tones for video calls and tutorials,一个错字都没有。做过AI生图的都知道这一关多难过,尤其是英文长句加数字,稍微一多就开始糊。
这一套图拿去直接上listing,我判断大概率是能用的,最多再换换文案。
二、我把自己的skill搬了上去
Lovart这一版把skill做成了产品主线。广场上做电商的那几个(Amazon Listing商品图、Amazon A+内容、亚马逊商品套图)成熟度看起来最高。
![]()
但我更在意技能页里那个不太起眼的入口。点创建旁边的小箭头,有一项叫导入技能,弹窗上写着:
将技能文件夹或 ZIP 文件拖到此处 —— 支持 Claude Code、Codex 及其他标准技能格式,必须包含 SKILL.md
我盯着这行字看了几秒。这句话的意思是,我硬盘里那六十多个SKILL.md,理论上可以直接拖进一个设计agent里跑。
我先拿了个小的试水,一个字没改打包扔进去,直接就成了,多层references的目录结构完整保留。
然后我搬了huashu-design。
这是我四月份开源的设计skill,目前在GitHub已经2万多stars了。
![]()
但原版直接搬是搬不动的:SKILL.md有64KB,32个references,脚本文件1055个,整个目录265MB。Lovart那边的规矩是正文控制在一万token以内,而且官方文档写着「目前 Lovart agent 不支持运行脚本」。
所以我把它拆成了两半。判断层是三方向硬门、反AI slop清单、品牌资产协议、风格库、评审标准,这些是纯文本,不需要运行时。执行层是Playwright截图自检、ffmpeg导MP4、HTML转PPTX、并行spawn subagent,全部依赖能跑东西的环境,一行都过不去。
最后压出来的版本是原版的24%,带四个references。留下的全是不能跑的部分,砍掉的全是能跑的部分,而恰恰是留下来那一半,决定了它还叫不叫huashu-design。
我原以为一个skill的价值大头在它能调动多少工具、跑多少脚本。搬完之后我改主意了,至少在设计这件事上,能跑什么不是重点。
传上去之后我顺手用Lovart给它做了张封面:深色木质工作台俯拍,并排摆三张风格明显不同的海报小样,一只手伸向中间那张。一次出图,没返工。
![]()
用Lovart给一个要放在Lovart上的skill做封面,这个循环挺有意思的。
写这篇的时候它已经过审上架了,你在技能广场搜huashu-design就能找到,直接添加到对话就能用。
三、huashu-design里的两件事 一件是60种风格,还有个掷骰子的机制
我很早就意识到,其实没有绝对好的设计。
同一种风格见得多了就会腻,就会觉得这一看就是AI做的。所谓的AI味,很多时候是画得太一致闹的,跟糙不糙关系不大——每次都是米白底、大留白、一个点缀色。
所以我在skill里内置了风格库,按产出形态分三个分区,网页20种、演示文稿20种、信息图20种,一共60种,是我做了非常非常多的尝试和调研才选出来的。
但光有库不够。模型有个很顽固的毛病:你不逼它,它每次都会偷偷选那个最安全的极简。你让它出三个方向,它给你三个米白底加留白,只是点缀色不一样,三个方向长得像一个方向的三次微调,用户等于没得选。
所以我加了个纯随机的机制:在Claude Code里用当前时间的秒数掷骰子,二十选一,抽到几号就按那个风格做。用时间掷骰子,是为了物理上打断模型的确定性偏好。Lovart那边跑不了脚本掷不了骰子,我就换成硬约束——其中一版必须落在大胆派分区。
不过用了这么久,我又觉得60种不够用了。风格是会消耗的,用得多了就从新鲜变成又是这个。这个库我大概会再扩一轮。
另一件是taste到底是什么
我们经常提,AI时代最重要的能力之一是taste。但taste究竟是什么?
我的理解是两层。第一层是你见得多,脑子里有没有一个够大的样本库,知道及格线在哪。第二层是你能看见东西之后再判断和选择,把候选摆在面前,指着说这个。
第二层更难,也更容易被跳过。因为大部分AI产品的默认行为是给你一个答案。你觉得不对,它问你哪里不对,你说不出来。你说不出来不是因为你没品味,是因为你手上只有一个东西,没有参照系。
所以我在huashu-design里立了条硬规矩:不管什么需求,默认先出三个差异化方向的真实初稿让你选,选定了才深化。三版必须结构性互异,不许共用一套版式只换配色,展示完必须停下来。
关键在真实初稿这四个字。绝不让用户在只有文字、没看到视觉的时候选风格,因为他没有依据。
这条在Lovart上验证得挺彻底。我给它的活是成都独立咖啡品牌慢山的开业海报,要精品咖啡的专业感,不要网红打卡风,没有现成的品牌规范和logo。
它先搜了三张参考图,其中一张明确标着「此图仅作为需规避……」——主动找了张反例来避开,这个动作我在skill里只写了原则,没写具体操作。然后出了三张真实海报,统一1536×2048:
![]()
三版分别走了风格弹药库、现实参照(对标 Blue Bottle 和 % Arabica)、最佳设计师(原研哉式东方极简)三套逻辑,落到画面上是暗调静物、建筑摄影、抽象符号。版式确实互异。摆完它停下来问选哪一版,没往下做。
然后我做了个对照:新建空项目,不挂任何skill,发一字不差的同一条需求。它也搜了参考图,但画布上什么都没生成,抛给我一组纯文字选择题:
三张参考图的风格怎么融合? A 极简克制:暖棕/深底+手冲器具居中+大字标题,干净专业 B 现代排版:米色+深棕+手冲器具hero+信息标签,层次丰富
你读一遍极简克制和现代排版这两个词,能预判做出来长什么样吗?反正我不行。而且它问的是怎么「融合」,默认要收敛成一版,不打算发散成三版。这是模型的默认偏好,跟Lovart没关系,任何agent不加约束都这样。
要说句公道的,裸跑那组也做对了一件事:它问开业信息时特意加了句「(事实信息我不能编造)」。这条是Lovart自己的基线,跟我的skill没关系。
四、然后我发现了一件对我更要紧的事
这次我还测了一个之前没测过的方向,让它做网页。
Lovart这一版的产物不止图了,Motion动效、Lottie、GIF、可运行的HTML网页、PPT都能出。我挂着huashu-design,让它给HuaStudio花录做一个产品落地页。那是我自己做的macOS录屏工具,已经上架Mac App Store,永久全免费、全部开源。
我把花录现在的界面截图丢给它当参考。它对每一张参考图分别写了一段分析,抄两段原文:
作为产品界面的身份锚点。在生成同款 HuaStudio 产品界面/主视觉时必须引用本图,保留 HuaStudio 品牌标识、左侧导航(Record / Videos / Screenshots / Settings)、中央录制模式选项(Full Screen / Window / Area / Camera)、音频与摄像头开关、红色录制按钮、最近录制缩略图、摄像头画中画圆形预览(人物可替换,控件形式保留)、深色玻璃质感与橙蓝渐变背景、MacBook Pro 展示框。产品核心布局与固定组件不可改动,网页装饰元素与排版可自由调整。
作为对话式 AI 剪辑功能区的风格与交互参考。可借鉴右侧 AI 聊天面板、用户指令气泡、AI 反馈、底部快捷操作与时间轴的组合方式,以及深色编辑器视觉风格。不可照搬画面素材与第三方产品元素,需替换为 HuaStudio 的 AI 剪辑界面、品牌色与文案。
还有第三段更有意思。我丢进去的参考图里混进了一张别家录屏产品的截图,它自己认出来了,写了一句「不得使用 ××(某录屏产品)品牌名、Logo 及第三方文案,必须替换为 HuaStudio 的导出流程与品牌元素」。
这几段的共同点是,它对每一份参考都同时回答了两个问题:继承什么,以及不继承什么。我自己写AI视频prompt的时候踩过这个坑,只写参考这个,模型会把参考里的一切都端过来,包括你完全不想要的那部分。第二个问题必须写出来,Lovart在这一版里把它做成默认动作了。
产出是三张产品界面主视觉,加一个能直接打开的HTML落地页,2560×1440,首屏写着「为教程创作者而生的 macOS 录屏工具」。
![]()
网页这块有个地方值得单说。它出的HTML是设计优先的,页面里的元素在画布上可以直接选中、拖拽、改尺寸、换图。 我点了一下落地页里那张产品图,它就被选中了,浮出一条编辑栏,W 1080、H 608、适应、填充、替换,全都能改:
![]()
这跟大多数coding agent给你的东西不一样。那些工具交付的是一份代码,你要改一个图的位置,得回去改CSS。这里交付的是一个还能继续设计的对象,改完了再导出。对不写代码的人来说,这个区别不小。
我把它和花录现在真实的样子放一起看了半天,logo 和界面都对了一遍:
![]()
完全不一样。而且说实话,Lovart出的这版比我现在的强多了。
我现在这版是典型的能用就行,功能都在,但视觉上是工程直出的样子,参数面板密、说明文字多、层级偏平。Lovart那版组件成体系、有呼吸感、该重的地方重该轻的地方轻,中文界面零错字,录制参数、时间轴、右侧摄像头设置各归各位,连边框颜色和背景虚化强度这种细项都排进去了。这个完成度,说它还站在AI设计这一档的最前面,我觉得不算过誉。
这件事让我冒出一个念头:早知道我就先拿Lovart生成原型设计,再去让coding agent写代码了。
我以前的流程是反过来的。想清楚功能,让Claude Code直接写,写出来什么样就是什么样,视觉是代码的副产品。结果就是我所有产品的界面都长得像同一个人做的(因为确实是),审美天花板卡在AI默认审美那条线上。
如果先在Lovart里把界面做出三个方向、选定一个、把那张图交给coding agent说照这个实现,视觉这一环就有了独立的设计输入。
对我来说这算是解锁了一个新的开发模式,我准备下一个产品就这么试。
顺带一提,这几张图看起来也很适合直接拿去当App Store的宣传图,这个我倒是没想到。
动效也真的能出
我还试了Motion。让它给慢山做一组品牌动效,一个logo开场加一条产品动图,要求是能直接播放的成品。
它给的logo开场是这样:和纸纹理的底,「慢山」两个字用毛笔一笔一笔写出来。
![]()
五、剩下几个更新
一键转矢量。画布上选中位图,在图像的二级编辑工具里点一下,出SVG,自动识别轮廓和形状生成多路径。做logo和icon的时候这一步是刚需。
![]()
视频编辑。 画布上选中视频可以点编辑视频,支持剪切、拼接、删除这类粗剪,也能加字幕并编辑内容和样式。
Motion。 官方那几个动态海报的例子做得比我的好,一并放在这儿:
![]()
![]()
连接器。 首页那一栏里除了灵感采集还有个连接器,连上自己的Pinterest账号,你在Pinterest上Save过的东西,直接就能在Lovart里看到和调用。
![]()
六、最后
灵感采集和skill看起来是两件事,一个管素材进来,一个管方法沉淀。顺着taste那两层去看,它们是一头一尾。
灵感采集解决的是见得多。你在小红书、在亚马逊、在Instagram上看到的每一个顺眼的东西,两秒钟就能进你自己的库,日积月累,那个库就是你判断力的地基。
skill解决的是看见之后能选。它把方法和判断固化下来,让agent每次都先摆出候选再问你。
中间是Reference在做翻译,把你收进来的东西,翻译成它能理解的继承什么、不继承什么。
所以我说它把设计的流程从前到后做透了。从灵感在哪儿看到、怎么收、怎么被理解,到用什么方法做、出几个方向、你怎么选,再到出什么形态的产物、怎么进入下一个工具,这一条链上每一环它都动了。
至于taste,我越来越觉得它没那么神秘。它就是见得多,加上有机会看见了再选。前一件是输入的量,后一件是决策的形式,两件都是可以被产品设计出来的。剩下那一下,指着说就这个,还是你自己的事。
![]()
Just design。全新版本已经向所有用户开放,国内直接访问:
https://www.lovart.art/
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.