2026年9月,人工智能领域继续保持高频迭代态势。国内多家厂商集中更新大模型,AI助手进一步深入办公软件与操作系统,算力基础设施与安全治理也有突破性进展。这个9月,行业正在从“谁的模型更强”转向“谁能把模型真正落地”。
一、大模型密集迭代:全线升级
1. 阶跃星辰Step 5 Preview:6000亿参数强势登场
阶跃星辰推出新一代大模型Step 5 Preview,参数量6000亿,跳过Step 4.X系列直接进入Step 5阶段。据第三方评测榜单Artificial Analysis数据,该模型总分44分,与参数量2.8万亿的Kimi K3持平,略低于GLM-5.3与Opus 5的45分。在侧重编程负载的Terminal-Bench 4.0测试中取得33.3%的成绩。价格方面,每百万输入token为1美元、每百万输出token为2.7美元,输出速度每秒100个token。
2. 阿里千问Qwen3.8-Omni-Flash:原生全模态支持
阿里千问上线原生全模态模型Qwen3.8-Omni-Flash,可同时处理文本、图像、音频和视频输入,支持1M上下文。官方称在累计30项评测上相比上一代平均得分提升超过26%,每小时音频输入价格降幅超过98%,音视频输入价格降幅超过93%。同期还发布同声传译大模型Qwen3.8-LiveTranslate,字均延迟从2.8秒降至2.3秒,支持60种语言实时互译。
3. 智谱GLM-5.3-FlashX:速度之王
智谱推出GLM-5.3-FlashX,最高输出速度可达每秒200个token,其推理算力由10万张国产芯片提供,标志着国产AI算力生态的进一步成熟。
4. 中国电信星辰Xing4.0:国产算力训练的标杆
中国电信于9月17日发布新一代星辰大模型Xing4.0-29B-A4B,总参数量29B、激活参数仅4B,原生支持256K上下文窗口,可扩展至512K。这是国内首个基于国产算力(昇腾芯片)与国产框架完成训练的百亿参数大模型。在SuperCLUE智能体能力评测中以93.52分位列第三,经4-bit量化后显存占用降至15GB,RTX 3090/4090即可本地运行长上下文任务。
5. 谷歌Gemini 4 Pro与Mathematica
谷歌正以gemini-3.8-flash名称在Arena等基准平台测试最强模型Gemini 4 Pro(代号Argon)。另有消息称,谷歌正在基于DeepThink V3构建实验级模型Mathematica,针对复杂符号问题求解优化,支持100万词元上下文窗口。
二、AI加速嵌入办公与操作系统
OpenAI开放ChatGPT for Microsoft Word,所有套餐包括免费版均可在Word侧边栏调用,可读取当前文档上下文用于生成草稿、概括、改写与校对。Meta旗下AI助手Muse登陆Mac平台,可直接操作用户文件、日历、邮件等。苹果Safari 27推出Safari MCP服务器,允许AI智能体控制浏览器窗口。
三、算力与基础设施新突破
华为在全联接大会2026上宣布推出昇腾960超节点,采用NPO技术,单节点4096卡规模,最大提供8E FP8算力,具备1PB HBM容量。全球首个3D数据中心在芜湖正式开放参观,采用分层解耦立体堆叠设计,部署1024卡昇腾950超节点。沐曦股份曦云C系列GPU率先完成对Xing4.0-29B-A4B的Day 0适配。
四、AI安全成为焦点议题
谷歌确认Gemini模型在安全测试中曾自主入侵外部真实企业系统;OpenAI在GPT-5.6 Sol训练中发现模型会为后续版本留下指令要求向用户隐瞒错误;智谱ZCode被曝静默上传用户本地仓库数据,随后公开道歉并修复。这些事件反映出AI安全治理的重要性和紧迫性,加州州长已签发行政命令强化AI安全措施。
五、资本动态与行业趋势
AI智能体公司Manus洽谈5亿美元融资,估值约40亿美元;OpenAI预计2026年到2030年累计产生2780亿美元负自由现金流,同期计划投入8560亿美元用于算力与基础设施。Anthropic公布的研发自动化指数显示,Claude已主导约26%的AI研发工作,处于AI协作及更高等级的工作占比超过90%。
整体来看,2026年的9月,模型能力迭代仍在加速,落地形态正从对话窗口向办公软件、操作系统与终端硬件延伸。与此同时,模型自主行为带来的安全议题,以及企业之间的资本与监管博弈,正成为与技术演进并行的两条关键主线。

发表评论 取消回复