MacTalk

搜索还是走到了“任务”这里,百度到底想干嘛?

最近 Agent 和 任务工具真的是太卷了,你方唱罢我登场,刚体验完一个又出一个,这不,百度的文心助手新上线了一个“任务”的新特性。任务意味着什么呢?意味着交付。百度也从搜索走到了交付这里。正好手头有个任务,让文心助手试试。 1
这个任务是:以比亚迪最新一期财报为对象,结合公司公告、业绩说明会、过去八个季度数据、卖方预期、同行财报和股价表现,完成一次财报事件分析。 我需要它要给出三种情景下的盈利预测和估值区间,列出五个持续跟踪指标,最后交付晨会简报、可编辑财务模型和交互式看板。最后加了一条约束:如果预期没有可靠来源时,必须标记缺失,不能自行构造。 这类任务很适合看任务类 AI Agent 的能力。一头连着公开信息的检索和辨别,一头连着表格计算、图表生成与文件交付,中间还有财务口径、时间边界和缺失值处理。这其中任何一块出岔子,最后的文件再漂亮也没用。 过去我们会把这种事通过搜索、人工分析,再用 Excel 和 PPT 完成,现在丢给 Agent 就好了。 文心助手先理解问题,确认任务,再加载金融数据查询、交互式分析报告和数据可视化等一系列 Skills 工具,进行了多轮信息检索、代码运行、文件生成与结果校验。
整个过程用时 13 分 33 秒,最后列出三份交付物:一份交互式财报看板、一份五分钟晨会简报,以及一个包含五个 Sheet 的 Excel 财务模型。
从结果看,它抓住了原任务中最难处理的一项约束。系统明确标出, 2026 年一季度完整的卖方一致预期在公开渠道存在缺失,使用个别机构口径时做了说明;部分季度费用分拆没有可靠来源,模型中也保留了空值。 它还给出了月度产销、海外产能、汇率与套保、新能源车渗透率等五类跟踪指标,并标明更新频率和数据来源。 Excel 按八季度数据、毛利拆分、预期对比、三情景估值、同行比较和领先指标分成六个 Sheet,看板则把趋势、利润归因、预期差与行情解释放进八个模块。
这已经比 “生成一篇财报分析”向前走了很远。它交付的对象是一套可以直接使用并继续工作的成果:晨会的内容可以直接用,分析师可以看报表,修改假设,管理者还能在看板里看趋势。
有个朋友的小孩快中考了,报志愿挠头的很,问我怎么办。我就想,这事也可以让文心助手试试,于是我告诉它:帮我做一个中考志愿填报决策工作台,输入分数和区排名后,按冲 /稳/保三档推荐学校,展示近三年录取分数线与位次走势对比,并给出每档的风险提示和填报顺序建议。保证数据的准确性和实时性。 这同样是个复杂长事务,还需要真实有效,文心的任务引擎用了 10 分钟的时间就搞定了这个工作台:
用户可以通过改变地区、中考分数和排名获得动态推荐结果:
从产品结构看,文心任务引擎 2.0 试图解决的就是这样的长链路。它把任务拆成“信息收集—加工处理—创作表达—成品交付”,背后涉及智能路由、长上下文记忆和工具调用。智能路由负责决定何时搜索、何时计算、何时生成文件;记忆负责让十几分钟甚至更长的任务不丢目标;工具则把语言模型的判断最终放到了表格、文档和网页上。 文心任务引擎这次展现出来的 Agent 任务能力和设计交互能力,可以说完成度非常高了。 2 文心助手的 “任务”功能,入口在移动端和 Web 端都有。移动端可以在百度 App 中进入“文心助手”,选择“任务”模式;Web 端直接打开文心助手网页,在输入框右下角切换即可:
我们可以把任务目标、需要的数据和交付要求写清楚,提交,任务就算交给文心助手了,它会把一句自然语言拆成一组可执行步骤,并在中途根据新信息调整路线。 你也可以试试,完全免费。 除此之外,我发现百度搜索的 GUI 今天也改变了。 文心助手的这个 “任务”模式,核心是做执行和交付,为了让这件事做得更漂亮—— 也就是说,系统既要理解问题,也要用合适的方式帮助用户理解问题 ——百度对 AI 搜索能力做了大量交互层面的升级。百度搜索截止目前已上线 2326 个 GUI 交互组件,举例来说,百度搜索上有覆盖 K9 阶段数理化中适合交互呈现的高频考点,并延伸到历史、地理、天文和通识规则。在百度上搜索“排水法怎么求体积”,你可以直接调整变量观察水面变化;你去搜索透镜成像,也可以移动物体 查看像的位置和大小。
这些功能今天都已经上线了,用户可以直接体验。 3 把这两部分连起来,我看到的是百度搜索又进化了,百度在建立一条从理解到行动的连续路径。简单问题由搜索给出结构化答案,抽象问题由交互模型帮助理解,长任务再交给任务引擎完成调研、计算和成品制作。 这个比 Google 的 AI Mode 又向前走了一步,搜索开始承担过去由多款软件和多种岗位共同完成的协调工作 。 文心助手模式在任务方面的得分也相当亮眼:在 PinchBench v2 中取得 94.6% 的综合成功率和 94.4% 的平均得分;在 SuperCLUE 的 XClaw 评测中获得 97.62 分。这说明工具调用、数据处理和长任务执行正在成为可量化的产品能力。对我来说,那个明确保留空值的财报案例,比单独一个高分更有说服力。
4 免费免费免费,重要的事情说三遍。在各大平台和工具纷纷收费的时候,百度宣布,文心任务引擎的核心高阶交付能力将 完全 免费,不设付费墙,也不对免费用户削减能力。 这个就非常良心了,也是我重点推荐这个产品的原因。 AI 普惠不是喊口号的,免费策略把复杂任务型 AI 给到了更多用户,让学生、小团队和普通打工人也能用同一套能力做研究、数据处理和内容交付。非常了不起。 这种普及也体现在了数据上: 6月,文心助手日活跃用户同比增长 83%,日均对话轮次增长超过两倍。 不过, 长任务需要搜索、模型推理、代码执行和文件生成,这种消耗远高于一次问答,平台必须用规模、效率和后续服务消化这笔账。 5 二十多年来,搜索一直在缩短人与信息的距离。 AI 加入之后,新的距离出现在信息与理解、理解与行动之间。百度这次把搜索、GUI 答案和任务引擎放在了一起,让搜索从一个入口,逐渐变成一套完成工作的基础设施。 搜索,和专业的 Agent 工具面向的用户是完全不同的,我们常用的各种 Agent 工具,很有一千万活跃用户了不起了,搜索面对的是几亿用户,这种变革更需要勇气。 事实上我更愿意把那个 13 分钟的财报分析任务看做一个起点,接下来真正值得观察的是,这样的免费任务能否长期维持,复杂的任务能力会不会持续提升,以及,普通老百姓是否愿意把越来越重要的工作交给它。 AI 搜索的变革,才刚刚开始。