程序员老鬼

当浏览器长出手,ChatGPT Atlas 开始替你点按钮。。。

我今天看到个挺有意思的…不对,是昨晚被朋友安利到脑壳发烫。他说:“你不是老吐槽AI在网页上只会‘说不做’吗?去用用 ChatGPT Atlas,真能动手。”这语气吧,挺欠的。我一边翻白眼一边装上,结果五分钟后——我开始闭嘴了。

Image

一开,界面那种“你认识它,它也认识你”的感觉:左边就是正常网页,右边是一条安静但很能说话的侧边栏。不同点在…它真的盯着你在干嘛。我在航司网站搜机票,它不光懂我的往返日期,还自己把表单补好了;到支付页前它停一下:“要不要先锁价?”那一下我愣住了,像电脑里突然住进个知道你穷怕的助理。

我不信邪,直接拿订酒店开刀。我在某家价格时高时低的酒店页面晃荡,Atlas侧边栏冒泡:“这家明后天有会员价,要不要对比附近三公里?”我点“行吧”,它开了三个新页,自动把入住/离店日期填好,还把早餐、可退改这种“人类必忘项”给勾上了。最离谱的——它还能识别我上一单里备注过“临近电梯要安静”,这次自己加上。那一刻我脑子里只有一句话:这玩意儿…会记仇

Image

然后我去看论文试试它到底懂不懂“上下文”。我在arXiv打开一篇Transformer小优化,Atlas右侧“咔”地长出一个结构卡:摘要—贡献—方法—结果—引用。你把鼠标移到“第3条贡献”,它会给你弹那一段原文,底下顺手给了两篇相近工作。我随口说:“把消融实验结论用人话讲讲,别讲太多公式。”它回我一个像同事会发的段落,末尾还贴上原文锚点。嗯,这就很…贴心但也有点吓人。

说个更“像懂你”的地方:记忆线。不是浏览历史那种干巴巴的,而是“行为线”。我上周在它这边跟AI聊了“巴塞罗那三天路线”,后来在航空公司查了两次价,昨天打开酒店页面,Atlas像猫一样从角落里探出头:“上次你定的是早去晚回,要不要顺手把第3天的足球场门票也看了?”我当时心里一咯噔——它把我“在做什么项目”拼起来了。方便是真的方便,但…你懂,那种被看穿的小惴惴也是真的。

我开始搞“Agent Mode”(它叫智能体模式),一句话就是:别教我怎么做,你自己给我做。我说:“帮我报个开发者大会,注册+机票+日程拉进日历,付款前提醒我。”它就像个认真过头的实习生:开新页—填表—勾条款—选票—跳转到支付页,停。侧边栏亮个确认框:“是这个卡吗?报销抬头要加不?”我点了“是”,然后它又问:“顺便拉上同事吗?”我…差点手滑。嗯,这模式很爽,但得给它画边界,不然它热情容易过线。

Image

Atlas还有个小能力让我暗爽:它会“接手网页里的重复动作”。比如我在一个招聘网站按同样的筛选条件换公司搜,它看两次就学会,下次直接把条件铺好,剩下给我挑人。你要是开GitHub,它能把repo的依赖、issue热度、最近merge节奏做个小卡片放右边,你扫一眼就知道这项目“在不在呼吸”。开B站(咳咳研究视频风格),它也会悄悄总结评论里观众吵啥,甚至给个“剪辑节奏趋势”。这种小卡片…很像你办公室那个嘴不多但永远补台的人。

当然,也有翻车。比如我让它“帮我填签证表,别漏东西”,它把我上次的旅行计划也当‘参考’,把一个“可能去的会议”写成“已确认参会”。幸亏确认框弹出来我看了一眼。不然你说…边界就这么一行弹框的距离。还有一次我让它“帮我整理购物车,挑便宜的”,它把我囤货里“快过期但便宜”的也推进来,省钱归省钱,肠胃…你懂。后来我学乖了:要么对它说“只看正价,不看临期”,要么直接锁策略:“低于XXX评分的别推荐”。

Image

有意思的是,工作流真的被它拨了一下。以前我做“下周项目准备”:开Wiki、翻会议纪要、去Slideshare扒老PPT、YouTube找两段讲解、再自己汇总。现在我给Atlas一句话:“帮我准备下周的模型评审材料:要点—风险—备选方案,全部带来源。”它自己去把相关页面扫一遍,右侧长出一篇“可交付草稿”,每段都带链接。你再让它“生成一个10页Doc草案”,它就把那堆段落排成页,还留了TODO。然后我只用干两件事:改判断、加边界。省下的时间…拿去争论更有意思的细节了。

讲道理,它也会“太懂事”。比如我在电商页面看手机壳,它以为我要买,主动问:“要不要把老订单里的壳尺寸核一下?你上次买的是Pro Max。”这当然贴心,但我那会儿只是随手看个色号。于是我的使用姿势慢慢变成: — 重要场景开“确认所有操作”模式; — 涉及隐私和支付,一定让它“只建议别执行”; — 任何“记忆”相关的都给它设保质期,比如“只记七天”。 这样相处,舒服很多。

对了,顺带说说体验里几个“小 Tips”,我自己试出来的:

让它先“讲明白打算做什么”,你就知道它是不是听岔了。比如“我准备开3个页:A对比、B对比、C下单前停”,这句话要出来。 多用“可度量”的条款:“只选可退改”“总价含税低于XXX”“离地铁步行≤10分钟”。它会乖得多。 记忆别全开。给它开“项目级短记忆”,关“全域回忆”。要不然你上周搜“猫粮软便配方”,这周它给你推荐“办公室咖啡豆低酸”…你懂那种被算法爱得窒息。

Image

安全这块,Atlas会给你一套“权限弹窗+审计痕迹”。每次它要点按钮、发表单、下载文件,都会亮个确认;事后右上角能看到“谁帮你干了啥”。这对团队合规和复盘挺好用——你能把“AI干的活”单独拎出来讲清楚。但也别神化,人忙起来就是会“无脑点好”。我现在给自己定了个小规矩:凡是钱和身份,永远二次确认;其余的,放手。

我昨晚躺床上瞎想:浏览器以前是“信息窗口”,后来成了“工作台”,现在Atlas把它往“行为界面”推。你 + 网页 + 它,像拼成了一个混合的大脑:你给意图,它跑流程,网页变成一个个可执行的节点。然后问题来了——当工具开始“接你手”,我们还剩下啥不可替代?可能就是“定义问题的锋利度”和“划权限的胆量”。一句话说不清,它就会往回补;权限划不清,它就会往前冲。

再说句现实的:一个人 + Atlas,能把一件小事从“我想做”到“基本办完”跑七成。订行程、报个名、拉会议准备、查价格、做个简报初稿…全都“像搭子”。团队里也许会变成这样:开会前不是“把链接发出来”,而是“让Atlas同步上下文”;会后不是“谁写纪要”,而是“Atlas先出草案,我们只补判断”。 听着有点科幻,但我这两天已经在这么用,效率肉眼可见地上来了,人也没那么被碎片化信息割得稀碎。

当然,别把它神当成神。它会犯错,会过度热情,会把“不确定”当“差不多行”。但只要你愿意把意图讲清楚、把边界画清楚,它就像一个靠谱的执行助理,把你从一堆小事里解救出来。剩下的那些真正费脑子的——取舍、价值、品味——还得你自己上。

我现在一只手已经把“让Atlas帮我干完”的按钮按住了,另一只手还扣在“所有操作先问我一声”的刹车上。 你呢?你愿意让一个懂你脾气的浏览器替你点按钮吗,还是更喜欢自己慢慢点着玩?我也不确定…嗯。