亲测教程丨谷歌最新Gemini 2.0 Flash原生图模型
就在今天,打开微信,看到一些群聊已经被谷歌的 Gemini 刷屏了,原来是谷歌 Gemini 2.0 Flash 原生图像生成功能上线,“说话就能实现 PS 照片”这个功能在 2.0 Flash 发布时就预告过了,一直没有上线,今天它终于来了。
一些 AI 群里时不时就冒出一些非常 nb 的 case ,大家已经用 Gemini 2 Flash Experimental 这个模型玩出了新花样。
别被文章滚动条吓到,下面很多图片 case。
Gemini 2.0 Flash 不仅能基于聊天指令生成图像,还支持以对话交互的形式,真的动动嘴就能编辑图像的局部或整体,同时较精准保留图像其他部分不受影响,不过亲测之后还是有一些不稳定。
话不多说直接先看几个case,让你感受一下该产品的震撼。(后文附简单上手教程)
01 一些有趣且 nb 的案例
先看几个 X 上面大佬们的:
1、这是一个 AI 工具绘制动漫女孩的过程,从草图开始,逐步转化为线稿、添加基础颜色,再到进行柔和阴影处理。
图源:@Linaqruf
2、按照上方像素风格的示例图,生成下方像素风格小狗图像的操作展示,提示词为 “Using the same style as this image, generate an image of a dog.”
@Robert Riachi
3、对一张戴帽男子正面照进行编辑,包括更改背景颜色、生成侧面视角以及 45 度视角的图像。
图源:@Linus Ekenstam – eu/acc
4、对一幅带有城堡背景的骷髅人物图进行编辑,通过指令 “can you have him raise his right arm, as if he is asking a question” 生成了骷髅人物右臂抬起。
图源:@Theoretically Media
5、先生成吉卜力风格的英雄角色,再将其置于类似《原神》的游戏场景中,并按指令让角色前进、靠近、移动至特定建筑旁以及攀爬墙壁 。
图源:@Cristian Peñas ░░░░░░░░
看望这些 case,许多群友直呼 nb,这个班是一点都不想上,麻了,学不完根本学不完。
当然,我们这一届群友也表示不服,大家也有很多的创意,下面看看一些群友们的创意。
1、生成一个番茄炒鸡蛋的图文教程。
图源:@Dukee
2、设计一个 3D 的米老鼠玩偶,从线稿开始设计到 3D 渲染。
图源:@Dukee
3、基于跑鞋手绘图进行设计,按指令逐步生成具有真实材质、不同视角的跑鞋渲染图,最后将跑鞋穿在模特脚上展示全身效果 。
图源:@一泽
还有很多很多有趣又 nb 的 case,比如一些人物的游戏关卡、用嘴 P 图等等,就不放了,实在是太多了。建议大家赶快去试一下。
玩法也是相当的多,比如,上面 X 大佬的第五个案例,生成的英雄角色,然后让角色在元神的场景里面前进、跳跃等场景,那我们借助一个其他的 AI 视频工具,是不是可以让我们原创的角色在游戏场景里面动起来呢,就有了下面这个这视频。
即梦 + 剪映后期
当然,现在模型的一些理解能力、输出能力还是相当不错,不过有一些细节还是处理得不太好,也是有挺多的翻车案例的。
比如,用一个之前 AI 换装经常用到的 AI 模特,让她“露齿大笑”。
嗯...,这个笑,多多少少没有一点美女的矜持。然后我就跟它说,“能不能笑的好看一点,稍微做一下表情管理”。
结果还是...,再试试吧,多 run 几次,最后还是先算了吧。
02 实操前的一些设置
以上哪些疯狂的、有趣的 case,都是用 Google Gemini 2.0 Flash Experimental 制作而成的。
使用地址:
https://aistudio.google.com/
进来之后,点击模型(Model),下拉找到 Gemini 2.0 Flash Experimental,更换模型。
输出格式(Output format)选择,“Images and text”,其他设置基本不用更改。
选择好模型,简单做一下设置修改,这样我们就可以发挥我们的创意了。话不多说,直接上手。
03 实操上手
我上来就直接叫它帮我做一个西红柿炒鸡蛋的教程。
给我一个番茄炒蛋的教程,包含图片没错,就是这样一句不到 20 个字的提示,它就能给我生成下面这样完整详细的图文教程。
从一个内容消费者来说,我们之前做一道才是不是一般都是从抖音、B站搜索视频制作教程,还要一些比较常规的菜,我们才能搜索的到。
搜到视频之后,我们还要一帧一帧的学习,但其实没有多大用,一般起锅烧油之后,你就会把刚刚学的忘得一干二净,还是得一帧一帧暂停着看,才知道怎么做,还得把食材事先全部准备好,不然就算忘记洗一个番茄,你就会手忙脚乱。
所以,现在有了 Gemini 2.0 Flash,我们不但可以了解到做一道菜需要什么食材、每一种食材都需要多少量,还可以查找得到一些不太常见的、原创的菜谱,搭配上图文教程,那学做一道菜是不是手到擒来。
Last but not least
现在,AI 的发展真的太快了,几乎一天一小更,七天一大更,就像群友所说,麻了,学不完根本学不完。
这场科技变革的洪流,可谓是浩浩荡荡,我们身处洪流之中,其中,有些人先拥抱 AI 站到了潮流之上,不过,这场科技变革,我们既是见证者,更是参与者,拥抱 AI,探索属于我们的新篇章。
关注公众号,用极客视角洞察未来!
往期精彩文章推荐: