Google 相册现在可以通过文字或语音直接编辑图像!
今天看到 Google 相册更新的新闻,我还真有点感慨。它居然可以直接用文字或者语音去编辑图像了,你想想啊,以前我们修个图,要么得点开 Photoshop 这种专业软件,要么手机上蹭蹭点半天滤镜、参数。现在呢,你直接跟它说一句:“把天调亮点”、“帮我去掉路人”,它就自动给你搞定了。效率高不高先不说,关键是这种操作方式,真有点像科幻片里的东西慢慢落地了。
而且更有意思的是,Google 不是单独推一个功能,它还跟自家的 Banana 编辑器联动。你点一下图片,系统就能直接唤起这个工具去处理。这个动作背后其实透出来一个很大的野心:Google 在把模型能力一点点地塞进自己的全家桶。
想想它现在手里有什么?模型有 Gemini,应用有 Gmail、Docs、Photos、Search,硬件有 Pixel 手机、Nest 设备,甚至 Chrome 浏览器本身就是超级入口。只要把模型和这些东西一个个整合起来,你就等于每天、每个环节都在和 Google 的 AI 打交道。这种黏性一旦养成,换谁都跑不掉了。
对了,我突然想到前几天看到美团发大模型的新闻,他们说得特别直白:别光卷科研报告,AI 要贴着真实生活场景走。Google 这波不就是同样的逻辑嘛?先别管什么通用智能,先让你在用手机、拍照、写邮件这些最日常的事情上,离不开它的模型。
不过这背后还有个挺有意思的对比对象——苹果。大家都知道,苹果向来走的是封闭生态,你买了 iPhone,最好再买 iPad、MacBook、AirPods,一套用下来体验确实流畅。但问题是,它在 AI 这块的动作,老实说有点慢。到现在,Siri 还是那个“智障助手”的代名词,虽然近两年也悄悄在系统里加了一些 AI 优化,比如照片自动分类、键盘输入预测,但这些都不是“亮点级”的功能。
现在 Google 整这么一出,等于是直接把 AI 晾到台面上跟你展示:“你看,AI 就能这样改造生活。”这就会逼着苹果思考:是不是要松动一下?
苹果其实特别怕“失控”。它的优势是硬件软件一体化,封闭带来的安全感和稳定性是用户买单的原因。但反过来,它的这种控制欲,也导致它在新技术的引入上比较保守。比如 App Store 的审核机制,比如第三方支付的限制,这些都是典型的“死守”策略。可 AI 这事儿有点不一样,它不是某个边缘功能,而是未来整个生态的底层能力。如果苹果继续拖,用户很可能会觉得自己买的设备“不智能”,这可就不是小问题了。
我脑补了一下场景:假如 Google Pixel 手机上,拍照之后你直接一句话就能把婚纱照修到完美,而 iPhone 用户还得自己慢慢调曝光、加滤镜,长此以往,谁更有吸引力?再比如邮件,Gmail 已经能帮你直接写回复、总结要点,iOS 上的邮件应用还是老老实实让你打字,那用户会怎么想?
所以我觉得,这一波对苹果真的是压力山大。它可能不得不在未来的 WWDC 上,拿出更开放的策略。比如允许第三方模型深度融入 iOS,或者干脆自己憋出一个大模型,全面替换 Siri,把照片、备忘录、邮件、信息全串起来。只是这样一来,苹果就要面对一个以前从没碰过的问题:它能不能放下点“控制欲”,让更多东西跑在自己之外?
说白了,Google 这波相册更新,看上去只是个“小功能”,其实背后是大战略的试探:先从最简单的照片切入,培养用户习惯,然后再把这种交互方式扩展到所有产品里。这种打法,最擅长的就是 Google。苹果会不会跟?我现在还真看不准。
不过话说回来,苹果也有它的底牌。比如说,它在硬件端的算力和隐私保护是绝对优势,如果它能搞出一套“端侧大模型”,让所有 AI 功能都在本地完成,既安全又丝滑,那可能又是一条截然不同的道路。只是,这个节奏到底赶不赶得上 Google 的“整合大跃进”,就不好说了。
反正我现在有点期待,下一届 WWDC,苹果是不是要憋个大招出来。要不然的话,Google 这波操作一旦跑通,苹果的“封闭生态”可能就真得重新审视了。
-END-
我为大家打造了一份RPA教程,完全免费:songshuhezi.com/rpa.html