截至 8 月末累计 1112 款生成式 AI 服务备案、731 款应用登记。头部模型综合能力趋于接近,SuperCLUE 7 月测试中 Qwen3.8-Max-0902、DeepSeek-V4.1-Flash、GLM-5.3、Kimi K3 总分集中在 70-73 分,竞争由参数规模转向技术、生态、成本与变现的系统比拼。
GLM-5 实现由"写代码"向"完成工程"跃迁;GLM-5.1/5.2 强化持续工作与百万级上下文;GLM-5.3 面向高价值复杂任务,在智能体编程(76.84)与任务规划(91.15)两项居首,GLM-5.3-Flash 面向高频规模化调用。
2026 上半年营收 9.54 亿元(+399.74%),其中开放平台及 API 收入 8.25 亿元(+2735.7%)、占比 86.5%,业务毛利率由 -0.4% 转正至 24.6%,商业模式由一次性部署转向持续调用。


| 厂商 | 代表模型 | 输入 | 输出 | 开源 |
|---|---|---|---|---|
| DeepSeek | V4.1 Flash | 1 闲 / 2 峰 | 4 闲 / 8 峰 | MIT |
| 腾讯 | Hy3 | 1 | 4 | Apache-2.0 |
| 智谱 | GLM-5.3 | 8 | 28 | GLM-5.3 License |
| 阿里 | Qwen3.8 Max | 12 | 36 | Qwen3.8-Max License |
| 字节跳动 | Seed2.1 Pro | 6 | 30 | 未开放权重 |
| 月之暗面 | Kimi K3 | 20 | 100 | Kimi K3 License |


| 参数 | GLM-5.3 | GLM-5.3-Flash |
|---|---|---|
| 定位 | 旗舰,能力上界 | 高性价比,低成本高性能 |
| 总参数量 | 744B | 320B(约 43%) |
| 激活参数 | 40B | 18B |
| 层数 / 专家 | 78 层 · 256 专家 | 45 层 · 288 专家 |
| 注意力 | DeepSeek 稀疏注意力 | 线性+稀疏混合 |







行业正处于多模态感知、复杂推理、智能体执行等前沿技术攻坚期,若核心技术突破进度、模型能力提升幅度低于预期,可能导致产业落地节奏整体延后。
下游场景规模化渗透受行业数字化基础、客户付费意愿、投入产出比验证等多重因素制约,企业付费转化节奏或慢于预期,产业价值兑现周期拉长。
数据安全合规、技术监管标准、产业扶持政策等制度仍持续完善,若监管趋严、扶持落地慢于预期或合规成本抬升,可能阶段性扰动技术迭代与商业化落地。
算力集群、高速互联、存储配套等基建投入大、周期长,若高端算力供给受限、建设进度慢于预期,可能形成算力瓶颈,制约训练迭代与应用规模化落地。