2026年杭州云栖大会于9月22日开幕,本届大会最直观的变化是:展馆里"AI能生成什么"的演示正在逐步让位于"AI能稳定交付什么任务"的实景。这标志着人工智能产业正在经历一场深刻的范式转换——从"能力验证期"迈入"价值兑现期",智能体(Agent)经济正式崛起。
智能体数量爆发式增长
国际数据公司(IDC)与浪潮信息联合发布的《2026年中国人工智能计算力发展评估报告》显示了一系列惊人数据:全球活跃智能体数量将从2025年的2860万个增长至2026年的7940万个,到2030年更将达到22.16亿个,复合增长率高达129.8%。
更为关键的是Token消耗量的指数级放大。报告显示,全球Token消耗量复合增长率达到4822.6%,约为活跃智能体数量增速的37倍。高盛预测,到2030年全球Token消耗量将较2026年增长24倍,达到每月约120000万亿Token。
这一数据揭示了一个核心趋势:智能体不仅仅是"对话机器人"的升级版,而是一种全新的"数字劳动力"形态。每一个活跃的智能体都在持续消耗算力、产生价值,正在重塑整个IT基础设施的格局。
云栖大会:AI从生成到交付
阿里巴巴集团首席执行官吴泳铭在2026云栖大会主旨演讲中做出了一个重要判断:"机器正在成为思考的主力,智能将成为可规模化供给的商品。"他预测,未来机器产生的思考总量可能达到人类的1000倍以上,而目前这一比例还不到人类思考总量的3%。
本届云栖大会以"智以致用"为主题,围绕Agentic AI集中展示了阿里云全栈AI技术。大会设置120多场分论坛,超1000家企业参展,其中最具代表性的趋势包括:
1. 企业级Agent进入真实业务场景
千问办公在大会上发布了"企业上下文"能力,Agent不再只是回答问题,而是理解企业内部的组织关系、业务规则、历史资料和岗位权限,逐步成为理解职责边界的"数字员工"。
2. AI Agent硬件亮相
千问办公推出首款AI Agent硬件QwenNote A2,该设备可转写和整理会议内容,并将其沉淀为可调用信息供Agent处理。用户可以通过语音交代任务,Agent持续跟进执行。这标志着智能体从纯软件形态向"软硬一体"演进。
3. 具身智能进入工业现场
智元机器人展示了工业上料装配环节,苏度科技将一条具身智能电池组装产线搬进展会现场。机器人不再只是表演,而是在真实工业场景中执行可泛化的生产任务。
4. 影视行业的AI实践
著名导演陆川携AIGC短片《历史·现场》预告片亮相,这是其首次深度使用AI创作影视级影像。按照传统制作方式,复原明代北京城和大规模爆炸场景需耗费数月时间和千万级投入,而借助AI工具仅用5天就完成,画面准确度达到预期的95%以上。
大模型密集迭代:2026秋季竞赛
2026年9月,全球大模型厂商迎来一轮密集更新:
国内阵营
阶跃星辰 推出 Step 5 Preview,参数量 6000 亿,在第三方评测榜单 Artificial Analysis 中总分 44 分,与参数量 2.8 万亿的 Kimi K3 持平。在编程负载测试中表现突出,输出速度每秒 100 个 token。
中国电信 发布星辰大模型 Xing4.0-29B-A4B,总参数量 29B、激活参数仅 4B,原生支持 256K 上下文窗口。这是国内首个基于国产算力与国产框架完成训练的百亿参数大模型,经 4-bit 量化后显存占用降至 15GB,RTX 3090 即可本地运行。
阿里千问 上线原生全模态模型 Qwen3.8-Omni-Flash,可同时处理文本、图像、音频和视频输入,支持 1M 上下文窗口。累计 30 项评测平均得分提升超过 26%,音频输入价格降幅超 98%。
智谱 推出 GLM-5.3-FlashX,最高输出速度每秒 200 个 token,推理算力由 10 万张国产芯片提供。
同时,阿里 Qwen 团队正在探索递归式自我改进技术,并计划训练 5 万亿至 10 万亿参数规模的新模型,以支持更复杂、更长程的任务。
国际阵营
谷歌 正以 gemini-3.8-flash 名称在基准平台测试最强模型 Gemini 4 Pro,内部代号 Argon。同时正在基于 DeepThink V3 构建实验级模型 Mathematic,支持最高 100 万词元上下文窗口,针对复杂符号问题求解优化。
OpenAI 全面开放 ChatGPT for Microsoft Word,所有套餐包括免费版均可在 Word 侧边栏调用,插件能够读取当前文档作为上下文进行智能辅助。
算力需求与基础设施升级
智能体经济的崛起对算力基础设施提出了前所未有的要求。IDC 报告预测,2026年中国智能算力规模将达到 2576.5 EFLOPS,同比增长 87.9%。到2030年将进一步达到 10524.3 EFLOPS,智能算力规模复合增长率高达 50.3%。
政策支持
工业和信息化部等五部门联合启动2026年度国家绿色算力设施推荐工作,新版评价体系突出能效、碳效引领,纳入单位算力能效、碳利用效率、数字化碳管理、产品碳足迹等指标要求。
产业格局
从城市AI算力发展格局来看,北京、杭州、深圳位列前三。北京凭借完整的算力供给产业链稳居首位,杭州依托AI创新企业集群保持第二,深圳作为AI服务器与算力芯片制造基地把握智能体爆发机遇进入前三。
全球竞争
OpenRouter 最新数据显示,中国AI大模型周调用量连续二十一周超过美国,稳居全球首位。DeepSeek V4.1-Flash 升至全球第一,周调用量达 15.8 万亿 Token,环比增长 219%。
芯片方面,平头哥发布真武 V900,算力达到上一代真武 M890 的 3 倍,相关集群架构可支撑更大规模的模型训练和推理。阿里云提出到2032年全球数据中心运营规模将超过 20GW。
智能体经济的未来展望
智能体经济的崛起意味着AI产业正在经历三重转变:
第一,从工具到劳动力。过去的AI是辅助工具,需要人类持续操控;智能体则能够自主理解目标、规划步骤、调用工具、执行任务,成为一种可以规模化供给的"数字劳动力"。
第二,从生成到交付。AI不再只是生成文字或图片,而是完成端到端的工作流——从理解业务需求到协调资源执行,再到输出可交付的结果。
第三,从参数竞赛到价值创造。随着DeepSeek等开源模型缩小差距,单纯扩大参数规模的边际收益正在递减。竞争焦点正在从参数规模转向真实生产价值,谁能更好地交付任务、解决实际问题,谁就能赢得市场。
吴泳铭的预测或许正在成为现实:"智能能力有望像电力和云计算一样,成为可以大规模调用的基础资源。"当智能体数量达到数十亿规模、Token消耗量以数千倍速度增长时,我们面临的不仅是一次技术变革,更是一场深刻的经济形态转型。
智能体经济的大门已经打开,2026年是它的元年。

发表评论 取消回复