上周六晚上,我在家做了一件挺离谱的事。
我开了一台电脑,打开Claude的桌面版,跟它说,我下周要去一趟成都,三天两晚,预算五千以内,帮我把机票、酒店、行程,全部搞定,最后给我一个PDF。
然后我就去洗澡了。
等我擦着头发回来,桌面上多了一个文件夹,里面有比价后选定的机票截图、三家备选酒店的对比表、按我饮食偏好排过序的餐厅清单,还有一份排得清清楚楚的三日行程PDF。它甚至贴心地标注了,第二天下午两点有暴雨预警,建议把户外项目挪到上午。
我看着那个文件夹愣了快一分钟。
不是因为它做得多好,坦率讲,里面有些地方我并不满意,比如它选的那家酒店我去过,不算特别推荐。我愣住,是因为我突然意识到,这玩意儿,已经不是我熟悉的那个AI了。
它不再是我让它干一句它做一句的那个工具,它是真的,自己在那儿琢磨怎么把这件事办完。
这就是我想跟你聊的事。从2025年下半年开始,到现在,AI圈里有一个特别明显的变化,几乎所有头部公司,都在悄悄把自己的产品,从工具,往一个新东西上转。这个新东西,英文叫Agent,中文翻译过来叫智能体。
很多人都在喊2026是AI Agent的元年。约26万人在关注这件事。我想认真聊聊,这事到底成色几何,是真元年,还是又一次PPT狂欢。
先说一个我自己的观察,过去两年,我们用AI的方式,其实一直是错的。
我说错,不是说我们用得不好,是说这个交互方式本身就拧巴。你打开ChatGPT,打开豆包,打开DeepSeek,本质上你都在干同一件事,你提一个问题,它给你一个答案。你再提一个,它再给一个。你像个甲方,它像个秒回的乙方,俩人一来一回,把一件事一点点磨出来。
这个过程,你有没有觉得很累。
我做自媒体三年多,每天大量用AI。我写一篇稿子,要跟它对话几十轮,让它查资料、改措辞、调结构、生成配图提示词。每一步我都得在场,每一步我都得当那个发指令的人。它强是真的强,但它是个等指令的强。
这就是工具的本质,工具是被使用的,使用者必须时刻在场。
而Agent不一样。Agent是你跟它说一个目标,然后它自己去拆解,自己去规划,自己去调用各种工具,遇到不会的它去查,遇到要付钱的它来问你,整件事它有主导权,你只在关键节点出现。
听起来差别不大对吧,但你真正用过一次,就会知道这是质变。
这种质变,技术上其实从去年就开始酝酿了。2024年底,Anthropic先放出来一个叫Computer Use的东西,让Claude可以直接操作电脑,看屏幕,移鼠标,点按钮。当时圈内人看了都比较震惊,但大众没什么反应,因为Demo归Demo,实际跑起来又慢又笨。
然后是今年,OpenAI推出了Operator,谷歌端出了Project Mariner,国内字节、阿里、智谱、Manus,全都在卷这条线。
到今年下半年,Claude推出Skills,Anthropic直接把Agent的能力,做成了开发者可以一行命令调用的标准件。差不多同一时间,OpenAI把GPT-5接入了Agent模式,谷歌把Gemini 3和它自家的整个Workspace全部打通。
这事我跟你讲,已经不是趋势,是定局。所有大厂都看明白了,下一战,不是模型谁参数多,是谁的Agent能真正干活。
那Agent到底能干什么活,我跟你讲几个我亲眼见过的场景。
第一个是编程。这个领域是Agent化最快的,没有之一。Cursor、Windsurf、Cline,再加上Anthropic自家的Claude Code,这几个工具今年的增长曲线,吓人到什么程度。Cursor的年化收入据传已经突破10亿美金,从0做到10亿,它只用了不到两年。
这是什么概念,Slack当年做到10亿用了五年,Zoom用了将近十年。
为什么这么快,因为它真的,把程序员从打字工,变成了导演。
我有个朋友是创业公司CTO,他跟我说,他现在写代码的方式是这样的。他跟Claude Code描述一个需求,比如我要做一个用户登录功能,要支持手机号、邮箱、微信三种方式,UI风格参考某某网站。然后他去喝杯咖啡。回来的时候,代码已经写完了,测试也跑了一遍,连README文档都给他生成好了。
他要做的,只是review一遍代码,调几个细节,然后commit。
他说他现在的产出,是去年的三倍。但更可怕的不是产出,是他现在敢做以前不敢做的东西了。以前评估一个新功能要两周,他就劝团队别做了。现在他知道,AI辅助下两天能干完,他就敢拍板上。
这种心理上的松绑,比效率提升还要值钱。
第二个是创作。这个我自己最有体感。
我现在写一篇深度长文,工作流是这样的。先跟AI聊选题,聊完了让它去搜资料,搜完资料让它整理成一个时间线和事实清单。这一步以前我自己做要半天,现在十几分钟。然后我开始写,写的过程中遇到具体的数据,比如某个公司的融资额、某个产品的发布日期,我直接圈出来让它去验证。写完之后,让它扮演一个挑刺的读者,把文章里逻辑不通顺的地方、煽情过度的地方、信息密度太低的地方,全部标出来。
这一整套,我管它叫AI编辑部,里面有研究员,有事实核查员,有挑刺读者。它们都是同一个模型,但扮演不同角色。
而真正的Agent化,是把这一套流程,固化下来,做成一个可以一键启动的工作流。你只需要给它一个选题,剩下的它自己跑。
我现在用Claude Skills在搭这么一套东西,搭好之后理论上,我说一个选题,它就能给我返回一份80分的初稿。
我知道很多写作的同行听到这里要警惕了,会不会被取代。我的判断是,纯靠堆砌信息和洗稿的内容生产者,2026年大概率要被洗一遍。但有独立判断、有审美、有人味儿的写作者,反而会更值钱。因为AI能帮你产出文字,但它产出不了你的立场。
第三个是数据分析。这一块普通人感知最弱,但变化最猛。
以前一个公司想做数据分析,要养BI团队,要买Tableau,要让分析师把SQL写得跟绕口令一样。现在,你打开一个Agent,把数据库丢给它,跟它说,帮我看看上个月哪个渠道的获客成本最低,转化率最高,给我一个推荐分配建议。
它会自己去查表、自己写SQL、自己跑结果、自己画图、自己给结论。
我前阵子跟一个做电商的朋友吃饭,他说他们公司本来要招两个分析师,最后没招,因为发现ChatGPT的代码解释器加上一个Agent框架,已经能干90%的活。剩下那10%,他们让一个会用AI的运营兼着做,效率比专门的分析师还高。
第四个是日常办公。这一块最日常,也最容易被忽略。
发邮件、订会议、做PPT、整理周报,这些事情每一件都不大,但加起来吃掉了职场人一半以上的时间。Agent现在的状态是,单独每一件它都能干,但还没有一个真正好用的产品,能把所有事串起来。
谁先把这个串起来,谁就是下一个微软。
国内现在跑得最快的是字节的扣子和Coze Studio,还有Manus,以及智谱新出的GLM Agent。我用下来,Manus在通用任务上确实做得不错,但它的问题是,慢,而且贵。你给它一个稍微复杂点的任务,它能跑半个小时,烧的token换算成钱,跟请个实习生差不多。
这就引出了一个特别现实的问题,Agent现在到底成不成熟。
我必须跟你讲实话,不成熟,还差得远。
我开头讲的那个成都行程的故事是真的,但我没跟你讲的是,那次成功之前,我失败了至少六次。有几次它把酒店预订的链接搞错了,有一次它给我推荐了一家已经倒闭的餐厅,还有一次它直接卡在某个步骤上不动了,我等了二十分钟才发现它在等我授权一个权限。
Agent现在最大的几个问题,第一是稳定性差,同样的任务你让它做十次,可能成功八次失败两次,而且失败的方式还不一样。第二是慢,复杂任务动辄几十分钟。第三是贵,token消耗是普通对话的几十倍。第四,也是最关键的,是它没法对结果负责。
你雇一个员工,他干砸了你可以骂他,可以扣他工资。Agent干砸了,你能怎么样,把它卸载了重新装一遍。
这就是为什么我对2026是不是Agent元年这件事,态度比较微妙。
如果你问技术上,2026会不会有突破。我觉得会,而且会很大。从模型能力到工具调用到长程规划,每一个环节都在快速进化。Claude 4、GPT-5、Gemini 3,这一代基座模型,已经把Agent的天花板抬得很高了。
但如果你问,2026年Agent会不会大规模普及,普通人会不会人手一个。我觉得悬。
因为普及的瓶颈不在技术,在信任。
你想想,你愿意让一个Agent,自己拿着你的信用卡去付款吗。你愿意让它,替你回复重要的邮件吗。你愿意让它,操作你的银行账户、医疗记录、社交账号吗。
我反正不愿意。至少现在不愿意。
而信任这个东西,是要时间养出来的。就像当年的移动支付,2014年微信支付推出的时候,大多数人也不敢把钱放进去,整整养了三四年,才变成今天这种你买杯豆浆都掏手机的状态。
Agent要走完这条信任之路,我估计也要三到五年。所以2026年,与其说是元年,不如说是分水岭。是那种,未来几年回头看,会发现啊原来变化是从那时候开始的,分水岭。
那对我们普通人来说,这件事意味着什么。
我说三个我自己的判断,不一定对,但都是真心话。
第一,从现在开始,必须养成跟Agent协作的习惯。不是用,是协作。区别在于,用是你发指令它执行,协作是你定目标它来规划。这两种思维方式完全不一样,越早适应越好。如果你2026年还在用一问一答的方式用AI,你大概率会被那些用Agent的人,按在地上摩擦。
第二,重新思考自己的工作里,哪些是流程性的,哪些是判断性的。流程性的部分,今年开始就要尝试交给Agent。判断性的部分,要更刻意地去打磨。因为未来你的价值,不在于你能做多少事,而在于你能在关键时刻做出多好的判断。
第三,警惕那些All in Agent的鸡血言论。包括我自己写的这篇。Agent是个好东西,但它现在还是个半成品,是个需要你哄着用、防着它出错、随时准备兜底的半成品。把它当工具放大版用,可以。把它当员工用,早。把它当救世主用,傻。
我想到最后一个画面。
二十年前,我爸第一次摸智能手机的时候,他怎么也搞不明白,为什么那个屏幕可以划来划去。他问我,这玩意儿到底是干嘛的,能比我那个诺基亚好用多少。
我当时跟他解释了半天,他也没听懂。但十年后,他自己用手机点外卖、坐地铁、跟孙女视频,比谁都熟。
Agent这件事,今天的样子,跟那时候的智能手机差不多。它笨拙、它贵、它经常出错,它让很多人怀疑这真的是未来吗。
但我可以跟你打赌,五年之后,你回头看今天,会觉得不可思议,原来那时候我们还在自己一个字一个字写邮件,自己一张表一张表填数据,自己一个网页一个网页查资料。
那个时候你会跟你的孩子说,孩子,爸爸跟你讲,2025年的时候,AI还得我一句一句教它干活。
你孩子大概率会愣一下,然后问你,那它平时干嘛呢。
以上,既然看到这里了,如果觉得不错,随手点个赞、在看、转发三连吧,如果想第一时间收到推送,也可以给我个星标⭐~
谢谢你看我的文章,下次再见。
BossAgents