手握专业级「AI美术团队」却只会吉卜力?5大典型玩法+视觉风格宝典(内附下载),让你立刻超越90%用户。
gpt-4o 原生ai作图,是llm的智力和ai作图能力的结合,本质上是ai从普通的美术生变成了清北文化水平的美术专家。
这开启了无限可能性。
ai进化的速度过快时,可能我们的脑子能理解(认知层面),但身体很难习惯(操作层面)。例如,现在,你可以用一句话把英文图片变成中文版,用一句话把一张照片里的宠物“拟人化”,大变活人。🤣
今天这篇文章,与你分享我在上周公司搬家之余的一些gpt-4o作图实践(插播预告,本周末线下熊聚,暂定周六下午,周五发正式预告),部分有用(提高效率和产出),部分纯粹娱乐,希望起到抛砖引玉、启发碰撞的效果。
用法1:把英文图片修改为“中文版”
prompt很简单:把图中文字修改为中文,生成中文版图片。
<<< 左右滑动见更多 >>>
用法2:设计自己的jellycat毛绒玩具
可以把普通的emoji一句话改成毛茸茸的玩具,例如,😂、🐗、🐻、🦜会变成下面这些:
<<< 左右滑动见更多 >>>
英文Prompt如下(把🎃换成自己选择的emoji):
Transform a simple flat vector icon of [🎃] into a soft, 3D fluffy object. The shape is fully covered in fur, with hyperrealistic hair texture and soft shadows. The object is centered on a clean, light gray background and floats gently in space. The style is surreal, tactile, and modern, evoking a sense of comfort and playfulness. Studio lighting, high-resolution render.
也可以用中文prompt:
将一个简单的扁平矢量图标 [🎃] 转换成柔软的、毛茸茸的 3D 物体。该物体的外形完全被绒毛覆盖,毛发质感逼真,阴影柔和。物体位于干净的浅灰色背景中央,轻轻地悬浮在空间中。整体风格超现实、触感强烈且现代,营造出舒适和俏皮的氛围。使用摄影棚级灯光,高分辨率渲染。
用法3:用任意视觉风格重绘任意图片
prompt很简单:用图2的视觉风格,重绘图1的内容。
这种“垫图”的方法非常有用,你需要用文字精确描述某种视觉风格,有图有真相,一图胜千言,你直接垫一张图,让gpt“复制粘贴”任何视觉风格即可。
<<< 左右滑动见更多 >>>
图中示例使用的是 tom gauld 的漫画。非常棒的艺术家,我很喜欢他的风格,也买过他出的卡通书。chatgpt 原生作画后,艺术家的视觉风格可以变得更普及,但这里的版权问题,可能需要 openai 好好想想怎么处理。
现在开始,我们需要开始做一件事:收集自己喜欢的视觉风格(visual styles),就像收集邮票一样。
我在eagle app里面新建了一个文件夹,就叫“visual style book”。目前时间有限,还没收集几张。但是,随着每天使用,这个积累会越来越多,效率也会越来越高。强烈建议你也试试。
这个过程的本质是积累自己的视觉风格词汇量。它可能是文字,如 ghibli cartoon style,也可能是展示典型视觉风格的图片,如埃尔热的 tintin 漫画。
我刚好有一份压箱底的“视觉风格手册”,里面把几乎全部的视觉风格分门别类,整理有序。你可以以此为基础,建立自己的视觉词汇库。样张如下:
给公众号发文本消息,“视觉风格”,或“风格手册”,或“视觉风格手册”,或者点击“阅读原文”,即可获得这本“视觉风格宝典”。
用法4:把图片换成透明背景png
这个案例的最大价值,是帮助我们理解gpt-4o原生作图的本质过程。
prompt很简单:remove the background. return transparent png.
<<< 左右滑动见更多 >>>
gpt-4o 作图时的准确还原能力,理性上知道这个事实,感性上仍然觉得不可思议。
这个过程不同于作图软件的操作,而是 llm 用眼睛输入了原图,然后用语言作为中介,再用手输出附加了各种指令的新图。
这个操作中涉及12个事物,仔细对比后你会发现,两张图有细微差别,都是 gpt 重画的,而不是仅仅把背景改成透明,把主体原样复制。
当然,也因为这个原因,如果处理的图片内容过于复杂,细节会有 bug,而且很难通过多次抽卡、涂抹局部后重绘来 debug,甚至会越改越糟。
目前还得靠专业修图软件,人机合作,组成完整的作图工作流。
即使以后 ai 画图能力升级了,解决了上面的 bug,真正决定效果的,也在于人,在于使用者。终身学习,永远是有价值、高价值的习惯。
用法5:宠物拟人化
这个用法纯属娱乐。展示llm的理解能力和ai画图能力结合,可以出现的高效用法🤣
你可以看到,家里的小仓鼠如果变成人,会是怎样的人?
<<< 左右滑动见更多 >>>
那可爱的小鹦鹉呢?
<<< 左右滑动见更多 >>>
试试网上的宠物图片,例如京巴:
<<< 左右滑动见更多 >>>
那么,那些不那么可爱、甚至有点丑的宠物们,变成人的话会是怎样的?(类似西游记里的妖精变成人)
提示,想好了再点开看🤣
<<< 左右滑动见更多 >>>
这只松狮呢?
继续提示,想好了再点开看🤣
<<< 左右滑动见更多 >>>
启示
gpt-4o原生作图能力的发布,不应当是3天有效期的热点,大家玩一下吉卜力风格图片,新鲜劲头过去了之后就忘掉。
而是说,当llm的智力和ai作图的能力结合,本质上是每个人都配备了一个清北文化水平的美术专家。
这样的ai到底能为你创造多大的价值?一方面取决于你的学习能力,一方面取决于你的想象力和审美。
agi的时代,是创造者的时代,是终身学习者的时代。