
2026年8月的上海,世界人工智能大会的展馆里,一个微妙的细节被大多数人忽略了——去年还占据C位的那些”大模型展台”,今年集体退到了角落。取而代之的,是一排排写着”智能体””Agent工作台””数字员工”的展位。一个参会者站在DeepSeek的展台前,看着屏幕上的演示发了一条朋友圈:”去年大家比谁家模型参数大,今年比谁家Agent能干活。时代变了。”这条朋友圈很快被转了几百次。不是因为说得有多深刻,而是因为它戳中了所有从业者心照不宣的那个判断——AI的赛道,换方向了。
这不是一次简单的产品迭代。
这是范式转移。
📍 2025年:智能体元年,种子已经种下
回溯整个故事的开头,要回到2025年。那一年被业内界定为”智能体元年”——大模型开始从被动问答工具向具备独立决策、执行能力的数字主体演进。传统通用模型只能依据人类指令完成固定输出,你问它答,像一本会说话的百科全书。而新一代智能体搭建了”感知—记忆—反思—决策—验证—进化”的完整运行闭环,能够自主识别环境、跨系统调用工具、动态规划任务。多智能体协同系统甚至可以独立完成复杂商业流程,形成脱离人类实时管控的自动化行为链条。这听起来像科幻,但在2025年下半年,已经有企业在用AI Agent处理客服工单、生成财报、管理广告投放。
种子已经种下了。
但那时候,大多数人还在纠结”哪个大模型更聪明”。各种排行榜层出不穷——MMLU、HumanEval、GSM8K——参数从百亿到千亿到万亿,每发一个新模型就是一场发布会盛宴,灯光如奥斯卡现场,参数堆叠堪比航天器发射倒计时。智能体?那只是大模型的一个”附属功能”,一个Demo级玩具。没人想到,仅仅半年后,这个”附属功能”会成为整个行业的主航道。IDC的数据后来证实了这个转折:2025年全球日活智能体2860万个,看似不少,但跟大模型API调用量比,只是零头。真正的爆发,要等到2026年。
📍 2026年Q1:资本用脚投票,9650亿美元的信号
2026年5月,Google I/O大会上,CEO皮查伊说了一句话:”AI的下一站,不是会聊天的模型,而是会行动的智能体。”几乎同一时间,Anthropic完成650亿美元融资,估值达到9650亿美元——正式超越OpenAI。资本市场用真金白银投下了赞成票:智能体优先。这个信号的含义很明确——投资人不再为”谁家模型参数最大”买单,而是为”谁家AI能真正替人干活”买单。Anthropic的Claude完成了从Chatbot向Agent的范式转移后,访问量逆势增长34.18%。这不是营销活动的效果,是用户用脚投票的结果。
9650亿美元。
这是一个时代的分水岭。
与此同时,大洋彼岸的中国市场也在酝酿变局。2026年Q1《全球AI资本追踪报告》显示,美国头部AI初创公司平均单季研发投入达18.7亿美元,但同期商业化收入占比不足12%。烧钱模式逼近财务红线的同时,开源模型——Llama-4、DeepSeek-V3——正以90%以上闭源性能、1/10部署成本的组合拳攻城略地。当一家县级医院用开源模型跑完全院影像初筛只要每月89美元,谁还愿意为闭源API多付2000美元?模型本身正在从”奢侈品”变成”基础设施”,就像5G基站和自来水管道一样。当模型不再是壁垒,什么才是?答案是智能体——那个能理解你的业务、调用你的工具、完成你的任务的”数字员工”。
📍 2026年Q2:国内大厂集体转向
进入2026年下半年,国内大模型厂商的动作突然密集起来,而且方向出奇地一致——全都转向了智能体。8月13日,DeepSeek开源Agent工作台Harness,首日GitHub Star突破3万。它的官方公式直白到令人发指:Model + Harness = Agent。翻译成人话就是:光有模型不够,你得给它一个”身体”才能干活。这个公式像是给整个行业划了一条起跑线——以前大家比的是谁的”大脑”更聪明,现在比的是谁的”身体”更灵活。
DeepSeek打响了第一枪。
随后是一连串密集的发布。8月20日,MiniMax发布多模态创作Agent工作台MiniMax Design,聚焦电商、教育、创意短片场景。字节豆包上线”技能·连接器”与”工作伙伴·工作小队”,已上架超200项标准化技能,让Agent能像人类团队一样分工协作。阿里千问推出Agent产品MuleRun及智能体编程平台Qoder,整合千问办公、千问协作构建企业级智能体生态。Kimi推出K3模型,在AI智能体知识工作基准AA-Briefcase上斩获1543分,超过GPT-5.6 Sol;其Agent集群可调度最多300个子Agent并行协作。智谱AI推出ZCode智能体开发环境,百川智能推出医疗垂直领域Agent”百小医”,阶跃星辰发布全球首个智能体原生操作系统Step AOS。
密集到让人喘不过气。
但密集本身就说明了一切。
📍 2026年WAIC:大模型隐身,智能体登台
如果说Q2的密集发布还只是”预热”,那2026年世界人工智能大会就是一次”集体亮相”。在WAIC展馆里,写代码、做报表、生成PPT、调用工具、进入业务工作流——这些成为了展馆里的共同关键词。正如O’Reilly技术媒体一篇文章所概括的:”模型不再为对话而生,而是为智能体而生。”大模型从展台中央隐身,智能体集体走向台前。这不是主办方有意安排的,而是参展企业自发选择的结果——当你的客户不再关心你的模型有多大参数,而是关心你的Agent能帮他省多少人力成本的时候,展台中央放什么,答案不言自明。
风向变了。
IDC的数据给这个判断提供了硬支撑:全球日活智能体从2025年的2860万个飙升至2026年的7940万个,增幅高达178%。这个增长曲线,跟当年智能手机取代功能机的曲线惊人地相似。178%的增幅意味着什么?意味着这不是线性增长,而是指数级爆发——每过几个月,使用AI Agent处理任务的用户数量就翻一倍。更重要的是,这些智能体不再是Demo——它们在真实的工作流中运行,处理真实的业务数据,产生真实的商业价值。从”能聊”到”能做”,从”能做”到”能赚钱”,这条路正在被快速走通。
178%。
记住这个数字。
📍 2026年8月:开源Agent工作台密集落地
WAIC之后,行业没有放缓,反而加速了。8月中旬成为开源Agent工作台的”密集落地期”。DeepSeek的Harness只是开始——它的开源意味着任何开发者都可以基于这套框架构建自己的智能体,而不用从零开始造轮子。这跟当年安卓开源对智能手机生态的意义如出一辙。字节豆包的动作更为激进——它不仅上线了技能商店和连接器,还在8月22日宣布将推出独立办公APP,直接对标腾讯WorkBuddy。AI办公不再作为附加功能,而是独立主战场。此前一周豆包已陆续上线多项功能:8月17日推出手机远程控制电脑,8月18日上线Windows虚拟桌面,8月21日上线技能商店覆盖200多个现成技能,可连接飞书、钉钉、企业微信。
2026年被称为”桌面Agent元年”。
字节、腾讯、阿里三强并立。
更值得关注的是跨场景的渗透。8月19日,火山引擎宣布特斯拉中国车机系统上线豆包大模型,覆盖Model 3、Model Y、Model S、Model X四款车型——这是特斯拉入华以来首次集成第三方大模型。豆包以独立应用形式出现在车机中,虽然暂无控车权限,但这次合作将大模型的对话与内容生成能力带入了车载场景,成为大模型进入车载流量入口的标志性案例。从桌面到车载,从办公到出行,智能体正在渗透到每一个有屏幕、有交互的场景中。当Agent无处不在的时候,”对话式AI”就真正成为了历史。
📍 下一个路口:从数字员工到物理世界
但故事到这里并没有结束。当数字世界的智能体赛道已经打得热火朝天的时候,另一条赛道正在悄然开启——物理世界的智能体,也就是具身智能。2026年世界机器人大会上,魔法原子、宇树科技、蚂蚁灵波科技等企业展示了搭载世界模型的机器人在工业制造、物流分拣、药房服务等真实场景中的落地案例。蚂蚁灵波科技的智慧药房分拣方案已在上海国大药房正式上岗,承担夜班分拣任务——这是行业首个落地真实药房环境的药品分拣方案。大晓机器人发布的”晓满””晓新””晓途”三套行业解决方案,分别切入即时零售、酒店服务、户外开放场景,全部具备规模化复制能力。
从屏幕里走出来。
走进真实世界。
宇树科技创始人王兴兴在大会演讲中给出了一个清晰的判断:具身智能产业爆发的重要临界条件是”在陌生场景中,通过语音或文字指令,机器人能够顺利完成约80%的任务”。他认为这一进程最快需要两到三年,慢则可能需要五年甚至十年。而银河通用机器人创始人王鹤更为乐观——他认为在训练技术持续突破下,具身智能有望在2028年迎来”ChatGPT时刻”。无论时间表如何,方向是确定的:AI的下一个阶段,不只是替你在电脑上干活,而是替你在物理世界里干活。从”会聊天的模型”到”会行动的智能体”,再到”会操作的机器人”——这条进化链的终点,是一个AI无处不在的世界。
“模型不再为对话而生,而是为智能体而生。”O’Reilly的这句话,或许会成为定义这个时代的注脚。当AI从对话框里走出来,走进工作流,走进生产线,走进药房和仓库——我们正在见证的不是一次产品升级,而是一次文明级别的工具革命。就像电力从实验室走向工厂改变了工业文明一样,智能体从聊天框走向真实世界,正在重塑数字文明的生产方式。这场范式转移没有发布会上的聚光灯那么耀眼,但它的影响,会比任何一次模型发布都深远。
别眨眼。
历史正在发生。














