上周三凌晨两点,我盯着屏幕,看一个AI替我干活。
它在做的事情是,把我前一天采访的录音转成文字,然后从里面挑出我标记过的重点,写成一篇初稿,再根据我历史发过的文章模仿语气调整一遍,最后把封面图也顺手给生成了三张候选。
整个过程我没动手。
我只在最开始说了一句,「把昨天那个采访整理成一篇能发的稿子,封面也搞一下,我去睡觉」。
四十多分钟后我醒了一次,看到工作台上一堆产物。稿子写得不算多好,逻辑混乱的地方还挺多,封面图也只有一张能看,但我盯着屏幕愣了很久。
因为半年前,这件事是不可能的。
半年前我用AI写稿,得手动把录音丢进转写工具,再复制到另一个对话框里让它总结,再换一个工具生成图,每一步都得我自己当那个搬运工,把上一个工具的输出,搬到下一个工具的输入里。
我是那条人形的胶水。
现在不需要了。AI自己变成了胶水,把所有的工具都黏在一起,自己规划,自己调用,自己出结果。
这就是过去半年里,安静地、但极其凶猛地发生的一件事。AI正在从工具,变成智能体。
如果你最近也总是刷到「Agent元年」「2026是Agent的iPhone时刻」之类的说法,先别急着关页面。这事虽然被吹得有点过头,但底下的东西是真的,而且跟你接下来一两年的工作方式、收入水平、甚至饭碗能不能保住,关系非常大。
我想认真聊一下。
先说一个我自己都觉得有点离谱的数据。OpenAI在今年早些时候推出的那个叫Operator的东西,是个能自己操作浏览器的Agent,你告诉它「帮我订一张周五去上海的高铁,要靠窗,下午三点之后的」,它真的会自己打开12306,自己点,自己选座,自己付款页面停下来等你确认。
这种事情两年前是科幻片里的场景。
而到了今年下半年,类似的产品已经不下二十款。Anthropic有Computer Use,谷歌有Project Mariner,国内字节有扣子空间,智谱有AutoGLM,Manus一度刷爆了整个朋友圈,紧接着是元宝、豆包、Kimi一个接一个上Agent模式。
整个行业像是约好了一样,在过去八个月里,集体掉头转向了同一个方向。
为什么这么齐?
因为底层那个最关键的能力终于成熟了,叫做长程任务执行。说人话就是,AI终于能一口气干完一件需要十几二十步的事,中间不会忘、不会乱、不会跑偏。
这事听起来好像没什么了不起。但你想一下,让一个人持续专注做完十五个连续步骤,不出错,不分心,已经挺难了。让大模型做这件事,过去两年里几乎全部翻车。它要么走到第七步突然忘了第一步的目标,要么在第十步死循环出不来,要么开始胡言乱语自我感动。
直到今年,几个关键技术叠加在一起,这事才被解开。
一个是模型本身的推理能力上来了,o1、o3、DeepSeek R1、Claude 3.7这一波模型,让AI从「条件反射」变成了「会停下来想一想」。
一个是工具调用变成了标准能力,MCP协议在年初被Anthropic提出来之后,半年内被全行业接受,相当于给所有AI和所有工具之间,统一了一套对话语言。以前每接一个新工具都得重新适配,现在一接一个准。
还有一个是记忆和环境感知能力,AI终于能记住你是谁、你之前让它做过什么、你的习惯是什么。
这三件事凑齐之后,Agent才真正从demo阶段,走到了能干活的阶段。
但我必须泼一盆冷水。
现在市面上99%的Agent产品,距离「真的能替你干活」,还有一段不小的距离。
我自己测过的几乎所有主流Agent,包括国内国外的,都有一个共同的毛病,就是简单任务它能做,复杂任务它装作能做。
比如你让它「帮我做一份关于新能源汽车的行业分析报告」,它会煞有介事地搜资料、列大纲、写正文、做图表,最后给你一份看起来体体面面的PDF。你看了开头会觉得,哎呦不错啊。
但你真的把它丢给一个懂行的人去审,对方会告诉你,数据是三年前的,论点是网上抄的,分析是套模板的,结论是正确但没用的废话。
它做的不是分析,是分析的样子。
这种「形似神不似」的问题,在所有需要专业判断的领域都存在。写代码也是,简单的脚本它写得飞起,稍微复杂一点的业务逻辑,它会给你写出一坨能运行但你根本不敢往生产环境推的东西。
所以坦率讲,我现在对Agent的态度是,又兴奋又警惕。
兴奋的是,它在「重复性高、规则清晰、容错率高」的任务上,已经真的能用了。我自己已经把很多杂活外包给它,每天能省两三个小时。
警惕的是,所有声称「Agent能取代某某岗位」的说法,目前都还是营销话术。它能取代的,是那个岗位里最机械的那20%。剩下的80%,包括判断、责任、共情、决策,它一项都还不行。
那为什么大家都说2026是Agent元年?
我的判断是,2026不会是Agent取代人的元年,而是Agent进入主流工作流的元年。
这两件事完全不一样。
前者是科幻,后者是现实。
我观察到一个特别明显的信号,今年下半年开始,国内一线的互联网公司,内部都在做一件事,叫「Agent化改造」。意思是把过去由人去操作的内部系统,全部改造成Agent能调用的接口,再把原本的岗位职责,重新拆分成「人做什么、Agent做什么」。
某大厂的一个朋友跟我聊,他们部门今年的KPI里有一条,是把团队的人均产出提升40%,怎么提升?不是加班,是每个人配一个Agent,原来一个产品经理要跟五个项目,现在跟八个,因为有Agent帮他写PRD初稿、跟进进度、整理周报、做竞品分析。
这不是替代,这是放大。
每一个原本能干活的人,被放大成一个能干两倍活的人。
这个事情在2026年会大规模发生。而且首先发生在那些「使用AI最积极」的公司和岗位上。
这就引出了我特别想跟普通读者讲的那个问题。
这件事对你意味着什么?
我先说一个不太好听的判断。
接下来一两年,职场上会出现一个非常明显的分化。一边是会用Agent的人,他们的产出会以肉眼可见的速度往上走,一个人干两个人的活,拿一个半人的工资,老板很开心,他自己也很开心。
另一边是不会用、不愿意用、或者用了但只会让它写写朋友圈的人。他们的工作不会立刻消失,但会越来越显得「贵」。同样的事情,别人用Agent十分钟做完,你用三小时,老板心里那杆秤会慢慢偏。
这个分化不会一夜之间发生,但它已经开始了。
我身边最明显的例子是程序员群体。今年初的时候,会用Cursor的程序员还算稀罕,到了下半年,一线大厂里不用AI编程工具的程序员已经被视为异类。明年这个时候,会用Agent模式(让AI自己规划、自己写、自己调试一整个功能)的程序员,会变成新的标配。
不会用的那批人,不是失业,是被边缘化。被分配到的活越来越边角,加薪越来越慢,最后自然而然被挤出去。
这不是危言耸听,这是过去十年互联网行业里每一波技术浪潮都重复过的剧本。从PC到移动互联网,从传统编程到云原生,每一次都是一样的,不愿意上车的人最终都得徒步。
那普通人现在能做什么?
我有三个具体的建议,不讲虚的。
第一个,从今天起,给自己定一个小目标,每周至少把工作中的一件重复性任务,交给Agent去做。
不要追求一步到位,不要想着「我要全面用AI重构我的工作流」,那是公众号文章里的话,落地会让你崩溃。从最小的事开始,比如让Agent帮你整理周报,让它帮你看会议录音的纪要,让它帮你回那些不需要动脑的邮件。
做满四周,你会发现自己对Agent能干什么、不能干什么,已经有了一种很直觉的判断。这种判断比任何课程都值钱。
第二个,认真挑一个Agent产品,长期用,深度用,别到处试。
现在Agent产品多得让人挑花眼,每个都说自己是最强的。我的建议是,别当成测评博主到处尝鲜,挑一个你觉得顺手的,连续用三个月。
顺手的标准很简单,看它有没有「记忆」,看它能不能调你常用的工具,看它出活的时候是不是符合你的口味。国内的话,扣子空间、AutoGLM、元宝的Agent模式都可以试,海外的话,ChatGPT的agent模式、Claude加上MCP是目前最强的组合。
我自己的主力是Claude,配合一堆MCP工具,因为它在「按我的口味干活」这件事上做得最好。
第三个,也是最重要的一个,重新想一下你工作里哪些部分是「真的有价值」的。
Agent会替你做掉一大堆杂活,这是好事。但如果你的全部工作,就是那些杂活,那你的危机就到了。
未来一两年,所有岗位都会经历一次价值重估。能被Agent替代的部分,价值清零。不能被替代的部分,价值翻倍。
不能被替代的是什么?是判断,是责任,是关系,是审美,是品味,是那种「为什么这样做而不那样做」的直觉。
这些东西没法靠看课程培养,只能靠真实地去做事、去犯错、去复盘里长出来。
所以如果你问我,2026年到底是不是Agent元年。
我的回答是,对那些已经把Agent当成搭档在用的人来说,是。对那些还在观望、还在嘲笑「这玩意儿不就是套了个壳的GPT嘛」的人来说,2026是分水岭的开始。
技术革命有意思的地方在于,它从来不会等谁。它发生的时候你可能根本没感觉,等你感觉到的时候,世界已经分成了两半。
而我们正好站在那道线上。
往前一步,是把AI变成你能力的延伸,是一个人活成一支队伍。
往后一步,是看着别人用AI完成你三倍的工作,然后纳闷自己为什么越来越没存在感。
选哪边,今晚就可以开始。
那个录音整理稿,我后来花了一个小时改完发出来了,反响还行。改的时候我一边骂AI写得啰嗦,一边庆幸自己不用从零开始。
这种又爱又恨的感觉,大概会陪我们走过整个2026。
但有一件事我很确定。
明年的这个时候回头看,今天还在犹豫「要不要认真用Agent」的人,会和今天还在用按键手机的人,处在同一个位置上。
不是手机不好,是世界变了。
以上,既然看到这里了,如果觉得不错,随手点个赞、在看、转发三连吧,如果想第一时间收到推送,也可以给我个星标⭐~
谢谢你看我的文章,下次再见。
BossAgents