昨天帮朋友改一张AI生成的海报,他想把画面里的杯子从左边挪到右边。我试了三个不同…

小白爱摸鱼 @chaozuoye
昨天帮朋友改一张AI生成的海报,他想把画面里的杯子从左边挪到右边。我试了三个不同的AI工具,每次一挪杯子,整个背景全变了——花瓶没了、窗帘颜色变了、连光影方向都反了。这种改一处动全身的毛病,AI绘图圈子里叫「一致性难题」,困扰了整个行业好几年。 今天阿里放出的Qwen-Image-Layered,直接把这个难题给解了。 它做了一件很简单但很颠覆的事:让AI学会「分层」。以前的视觉模型看图片就像看一张压扁的纸,所有元素糊在一起。新模型引入了Alpha通道,把图片拆成前景、背景、遮挡物等多个图层,每个图层独立编辑互不干扰。 具体能干什么? 把画面里的人往左挪20厘米,背景自动补全,边缘过渡自然到看不出痕迹。把某个产品的颜色从红色改成蓝色,其他元素纹丝不动。甚至可以单独调整某个图层的光影,而不用重新生成整张图。 训练方法也很聪明——团队从海量PSD文件里提取真实的图层逻辑,让模型从一开始就具备「分层思维」,而不是事后硬拆。 对于做商业设计、UI、影视后期的人来说,这基本意味着AI生图终于从「碰运气」变成了「可控制的生产力工具」。模型已在魔搭和HuggingFace开源,可商用。 相关链接 soft.china.com/article/284473…
23 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单