作者|冰拿铁
编辑|星奈
媒体|AI大模型工场
2026年了,说到AI干活天花板,你可能第一时间想到桌面的Agent工作台,Codex,Claude……
但你有没有发现,整个干活的过程,总有一种割裂感:
我们获取最新、最全的一手信息,比如行业数据、前沿研报啊,首选还是老牌搜索引擎,因为搜索引擎背后是千亿级的网页索引和多年积累的排序算法,能读懂模糊的语义,资料也更全面。
而工作台的内置搜索,多半是API调用,它们拿不到搜索引擎最核心的实时排序数据,只能机械地抓取摘要。
这就很尴尬了,“检索”与“生成”被强行拆分成,迫使我们充当人工搬运工,先去搜索引擎搜,再把搜到的信息复制粘贴到AI工作台;然后让AI工作台去写报告、去做PPT,做HTML。
窗口来回切换,思路频繁打断,效率大打折扣。
不过,百度文心助手最近在AI DAY上出手,正试图将这种割裂彻底终结:
依托其搜索基本盘,百度推出了面向大众的端到端AI交付平台,搭载于文心助手“任务模式”里,突破了传统AI对话“只给答案、不干实事”的局限,具备从“理解用户意图、自主规划、多步执行、成品交付”的全链路自动化能力。
依托智能路由、长上下文记忆与多智能体协同框架,它能直接交付包括金融、教育、办公等多场景复杂任务,且核心高阶功能永久免费。
在行业看来,这试图将“最强搜索能力”直接“焊死”在“最强执行引擎”里!
与此同时,同步升级的百度搜索GUI交互式答案,让搜索结果不再是一段静态文字,而是根据问题智能判断呈现形式,将知识组织成可拖拽、可调整参数、可实时变化的动态模型。
你发现了吗,百度一举消除了“检索”和“执行”之间的界限,让“搜”和“做”变成了一个动作,且搜索结果更便于理解了。
我等不及要试试了!
从“给出答案”到“帮你理解”:搜索引擎的第三次革命
回望搜索引擎的历史,可以粗略地分为三个阶段,第一阶段是帮我们找到答案,第二阶段是给出答案,也就是AI搜索时代,搜索引擎直接给你一段整合后的答案。
但问题在于,给出答案和真正理解之间,隔着一道认知的鸿沟。
有些问题,读一段文字就能理解,但有些抽象概念,光靠文字描述,大多数人看完依然似懂非懂。
这就是百度这次搜索结果页的GUI交互式升级要解决的问题:
现在打开百度APP,搜索复杂问题,返回的不再是一段静态文字,而是一个可操作的界面。
比如搜索“凸透镜成像规律”,TA给你一个可交互的界面,只需动手拖动物体,像的位置和大小便实时变化。
搜索“排水法测体积”,也可以通过调整参数,观察液面升降。
这套组件的逻辑在于,搜索先判断何种形式最利于理解,再将知识组织成动态模型。历史时间线可以滑动,珠峰海拔可以分层展开,台风成因可以模拟观察……太丝滑了吧!
我一个当年被理科虐过的人,居然看懂了。知识它终于进脑子了!!
据悉,目前该功能已上线几千个交互组件,精准覆盖K9数理化高频考点,还没高考的小孩有福了。
而且,百度还有个配套的神器,文心老师,9月7号上线,能够用动态板书,分层讲解,边讲边画,通过追问判断你卡在哪一步,再动态调整讲解路径,相当于给每个孩子配了一个耐心到不行的家教。
这让我想起2007年,乔布斯在Macworld大会上发布iPhone,把手机交互从物理键盘变成了多点触控屏,用户不再通过按钮操作手机,而是直接用手摸到内容。
百度GUI交互组件做的事异曲同工:
把搜索结果从可读变成“可操作”“可交互”,让用户不再只是阅读答案,而是亲手摸到知识的纹理。
这波可以说见证历史啊。
而且,这种搜索体验的变化已经开始反映在用户数据上。
今年6月,文心助手日活跃用户同比增长83%,日均对话轮次更是增长超过两倍。
这意味着搜索正在从一个“用完即走的入口”,变成一个可以持续交互、持续理解用户需求的AI工作空间。而当百度进一步把“理解”之后的“执行能力”也塞进这个入口里,事情就更有意思了。
实测文心任务引擎2.0:搜索原生Agent工作台有多强?
如果说GUI交互组件干的事是帮我们理解,那么文心助手任务引擎2.0,则要帮我们干活。
我丢了个商业需求给它,让它给一个银发族AI App做路演准备。
这活考的是深度商业分析能力,得从模糊的构想里提炼出市场规模、竞品分析、商业模式、财务预测,还得能扛住投资人的追问。
文心助手任务引擎2.0没有让我失望,它自主规划出四大模块,直接产出了12页完整PPT,配了4张核心图表,还附赠了一本详尽的《投资人Q&A备用手册》,连每页的演讲备注都撰写完毕。
融资路演的脏活累活,它一手包办了!
接着,我用专业金融需求考验它,筛选A股高股息标的,条件严苛,比如连续5年分红、股息率超4%、分红率控制在30%-70%。
来看结果,文心自动设定筛选条件,从60只股票中计算出“分红持续性评分”,对连续分红25年以上的标的给予高分,并将股息率超5%的自动标绿、冻结首行。
最终呈现的,是一份带有条件格式高亮的研报底稿。
广汇能源、山煤国际、格力电器、宇通客车……它逐一列出,并标注其为“长期饭票”。
英雄所见略同啊,我也喜欢董明珠!
然后,我想测测TA写代码的能力,于是乎,我让它制作快递行业近五年竞争格局的交互仪表盘。这不仅需要数据分析,更需要前端工程能力。
可见,它精准抓取了顺丰、京东物流及通达系七家公司的市场份额与单票价格数据,用HTML构建了一个支持时间轴拖拽的界面,时间轴在2021至2025年间滑动,点击顺丰Logo,弹出的正是其收购嘉里物流的当年大事记。
它还生成了一个四象限图:高端利基的顺丰、王者领跑的中通、低价冲量的通达系,气泡大小对应业务量,一目了然。
你会发现,它的干活能力不输任何头部Agent工作台,却多了一张王牌:文心任务引擎2.0长在了百度搜索二十余年沉淀的索引与排序体系之上。
这意味着它干活的“原材料”永远是最新、最全、最真实的。它不需要我像搬运工一样喂料,而是自己主动去信息源头“进货”,然后在搜索结果页直接“上菜”。
这种“所搜即所得”的体验,彻底消灭了在搜索框和工作台之间跳转的割裂感。以前我们在两个工具间疲于奔命,现在只需一句话,检索、分析、创作、交付一气呵成。
这种流畅体验的背后,是实打实的技术硬实力:
今年7月,在全球工程向AI智能体评测榜单PinchBench v2中,文心任务Agent以94.6%的综合成功率和94.4%的平均得分斩获第一。排在它身后的,是Claude Opus 4.8-fast、GPT-5.6-luna、Qwen3.7-max以及英伟达的Nemotron-3 Ultra等海内外顶尖模型。
国内第三方测评机构SuperCLUE针对“长流程任务”发布了专项榜单,在代码开发、内容创作、数据处理、研究分析、记忆能力五个维度进行综合评分,满分100。文心任务模式拿下了97.62分,位居榜首,将小米MiMoClaw、腾讯Workbuddy、月之暗面KimiClaw等一众产品甩在身后。
其中最令我关注的,是“记忆能力”那一栏,文心拿下满分100。
懂行的人知道这100分的含金量,任务引擎处理的是长周期任务,一份研究报告从接单到交付,往往间隔数小时,历经多轮对话。
AI若没有稳定的长时记忆,转头就忘,长周期任务根本无从谈起。记忆,是托付任务的命门。智能路由负责规划,自进化记忆负责上下文连贯,二者结合,才是“端到端交付”的底气所在。
此外,百度搜索二十余年的技术积累,加上猎户座AI引擎的多智能体框架,也让其在AI时代拥有坚实底气。
毕竟,搜索最擅长的就是理解意图、定位资源、组织信息,这套能力迁移到智能体上,堪称“降维复用”。
最关键的,是免费!盆友们!
拆掉付费墙,百度让AI成为“免费水电”
你可能觉得,免费有什么稀奇的,现在AI工具很多不都免费吗。
不是的兄弟,不是的,豆包高阶功能都收费了。
各大厂商纷纷将AI能力切割为三六九等,低价值的聊天免费,高价值的执行收费。
你去看看市面上的智能体,能无限制帮你把活干完且不收费的,基本没有。越是能交付成品的能力,越在试探付费墙。毕竟,“干活”与“聊天”是两种截然不同的商业模式,能交货的东西,天然被视为高价值商品。
百度偏偏反其道而行之,将最值钱的交付能力直接免费开放,太感人了。
往远了说,TA是在改写整个行业的定价逻辑,把赛道的竞争水位抬高了,别人在修付费墙,它在拆墙,最起码以后大家想涨价时,考虑到百度还在免费,高低得寻思寻思。
百度这波操作,也让“AI普惠”不再是口号,而是掷地有声的行动,我想起1880年代,电力刚普及之时,只有工厂用得起,普通家庭仍靠蜡烛照明。
等到当电力走进千家万户时,世界才被无死角地照亮。
AI亦然,最领先的能力如果只属于少数付得起费用的精英,它就只是少数人的玩具;只有当它变得人人可用,才能成为改变社会的公共基础设施。
让AI人人免费可用,这句话是百度AI Day的愿景,配合上TA免费的大动作,这句口号一点也不空。在这个AI能力纷纷“上锁”的年代,百度选择把钥匙交给所有人,这份大气,我只能说Respect:
对用户而言,高阶AI能力不再是少数人的特权,对行业而言,“观念的水位”,被永久性地抬高了。
数据支持天眼查,大模型独家合作账号










