AI 日报

2026 年 8 月 31 日 · 星期一
Top Signal · 核心叙事 8 月 31 日最硬的三条变化都不在模型层:工信部把人工智能应用服务商的数量写进部级目标并给出报送截止日,上市银行半年报首次把 Token 消耗量作为经营指标披露,国产 AI 芯片的缺口被换算成“需求约 400 万颗、交付约 300 万颗”的交付排期。模型侧的信号同样具体——DeepSeek 用 MIT 协议放出 V4 首个多模态权重,MiniMax 把 5 秒 768p 视频的生成时间压到 3 秒以内,生成第一次快过播放。政策、财报与产能三条线在同一天给出了可核验的数字。
TODAY'S SIGNALS
9
强信号 候选 44 条 → 精选 9 条
服务商数量被写进部级目标,Token 消耗被写进银行财报,视频生成跑过播放速度——同一天里,AI 的计价单位在三条线上同时换挡。

今日头条

工信部启动人工智能应用服务商培育专项行动:2026 年底资源池突破 2000 家,2027 年底不少于 3000 家

【事件】工业和信息化部办公厅 8 月 31 日发布《关于开展人工智能应用服务商培育专项行动的通知》(工信厅科函〔2026〕414 号,落款 8 月 27 日),提出到 2026 年底全国服务商资源池内服务商数量突破 2000 家、到 2027 年底不少于 3000 家,并要求各地区于 2026 年 12 月 1 日前报送资源池信息。

【背景】上位依据是《国务院关于深入实施“人工智能+”行动的意见》中“培育人工智能应用服务商、打造人工智能应用服务链”的部署,排在 2026 年 4 月“模数共振”行动与 6 月“人工智能+信息通信”意见之后,补齐服务端这块拼图。通知明确四项任务:摸排建档建立资源池、组建“模数共振、算电协同”类人工智能应用服务团、把解决方案封装成“小快轻准”产品包、以要素供给保障降低成本。落到钱上的工具是两类原文表述:探索通过首购首用、风险补偿等模式加大大模型、智能体、Token 等服务采购力度;用好“算力券”,引导服务商对接国家算力网络枢纽节点与中国算力平台。下辖国家人工智能产业创新应用先导区的省份,2027 年底本地资源池企业不少于 100 家。

【信号】把服务商家数写进部级目标,等于把“AI 落地最后一公里”从企业自发行为改成可统计、可考核的供给指标。反向风险是家数目标天然鼓励低门槛注册,2000 家的成色要看复杂场景交付比例而非数量本身。验证指标:2026 年 12 月 1 日首轮报送后公布的资源池名单与地区分布、名单中“专精特新”占比,以及首购首用与算力券的实际兑付金额。

智谱上市后首份中报:上半年收入 9.54 亿元同比增 399.7%,API 提价 101% 后开放平台毛利率升至 24.6%

【事件】智谱 8 月 31 日发布上市后首份中期业绩:上半年收入 9.54 亿元、同比增长 399.7%,毛利 2.52 亿元、增长 163.7%,研发开支 21.31 亿元、增长 33.6%,经调整净亏损 19.64 亿元、同比扩大 12.1%。当日公司股价收涨 9.63%,盘后正式纳入 MSCI 中国指数。

【背景】同期披露的经营口径比利润表更关键:MaaS 平台 Token 调用量较年初增长超过 40 倍,用户规模突破 740 万、覆盖 233 个国家和地区,API 定价提高 101%,开放平台及 API 业务毛利率升至 24.6%。这组数字与上一阶段靠低价换调用量的打法形成直接对照——24.6% 的毛利率水平仍低于成熟 SaaS,但已高于单纯卖算力的转售模式。研发开支 21.31 亿元是同期收入的 2.2 倍,亏损扩大主要来自模型训练与人才投入,而非销售补贴。

【信号】提价与放量同时成立,才是这份中报真正的议题:如果 40 倍调用增长里有相当部分由低价或额度补贴驱动,提价后的留存率会先于收入暴露问题。反向风险还包括大客户集中度与开源模型对 API 价格的压制。验证指标:下半年开放平台收入的环比增速、提价后的 Token 调用量曲线、740 万用户中的付费转化率,以及毛利率能否在 24.6% 之上继续爬升。

国产 AI 芯片 2026 年需求约 400 万颗、交付约 300 万颗,百万级缺口下算力订单排到 3 年后

【事件】央视财经 8 月 31 日援引行业调研数据:2026 年国产 AI 芯片需求规模约 400 万颗、实际交付约 300 万颗,存在百万级产能缺口。8 月国产 AI 芯片龙头半年报密集发布,上周五(8 月 28 日)壁仞科技发布财报、营收实现近 20 倍增长,寒武纪、摩尔线程等头部企业均实现营收大幅增长。

【背景】央视财经梳理的半年报数字为:寒武纪上半年营收 59.96 亿元、同比增长 108.1%,摩尔线程 17.36 亿元、增长 147.4%,壁仞科技 12.36 亿元、增长 1997.6%。紧张已传导到排期——内蒙古乌兰察布远景人工智能算力中心副总经理李军称在手订单已排到 3 年后,3 年内要持续交付;传统算力中心从土建施工到服务器上架通常近一年,行业改用 20 或 40 英尺标准集装箱方案,只要有满足条件并接通水电气的空地,24 小时内可完成标准部署。壁仞科技战略技术委员会主席李新荣称,国产芯片在性能与稳定性上已从“能用”跨到“好用”。

【信号】这轮缺口的性质与上一轮不同:过去讨论国产卡的焦点是能不能替代,现在变成什么时候能拿到货,定价权短期在供给端。反向风险在于排期是预期指标而非已确认收入,订单可改期、可取消,而 400 万颗与 300 万颗来自行业调研口径,不由厂商直接披露。验证指标:Q3 国产芯片厂商的预收账款与合同负债变化、集装箱式交付的实际上线规模,以及年底 300 万颗交付量的兑现比例。

上市银行中报首现 Token 量化披露:招行日均吞吐增超 78%,平安消耗超 53 亿、增约 130%

【事件】上市银行 2026 年半年报首次给出 AI 用量的量化口径:招商银行上半年日均 Token 吞吐量同比增长超过 78%、已落地领域模型 256 个较上年末增长 40%、AI 提效带来 1388 万小时等效人工工时贡献;平安银行 Token 消耗量超过 53 亿、同比增长约 130%;兴业银行已上线主流大模型 21 个、日均调用量超过 210 万笔。

【背景】场景规模同样进入财报:工商银行“工银智涌”落地场景超过 600 个、建设银行生成式 AI 覆盖超过 600 个应用场景、招商银行智能化场景落地 1386 个、中信银行超过 1900 个,中国银行构建超过 2200 个智能化助手并部署 3800 多个 RPA 自动化流程场景。工商银行副行长赵桂德称该行推动 AI 技术与经营管理全链条深度融合,其金融市场业务的智能询价交易占比已突破 96%、审核效率为此前的 5 倍。平安银行以对公业务为例,6 月末跨境业务放款效率较上年末提升约 30%。

【信号】指标变了,考核口径就跟着变:Token 消耗量进入财报后,银行间的 AI 竞赛第一次有了同口径的可比数字,78% 与 130% 这类增速会直接进入下一轮预算分配。反向风险在于消耗量本身不等于产出——招行的信息科技投入 46.79 亿元占营收 2.99%,低于 2025 年全年的 4.31%,投入强度与用量增长方向相反,说明单位成本在快速下降,也意味着“提效”口径仍由各行自述。验证指标:年报中 Token 消耗与业务收入或成本收入比的挂钩披露,以及智能询价占比、放款效率这类业务级指标能否延续。

DeepSeek V4 首个多模态模型开源:V4-Flash-Vision-Exp 以 MIT 协议上线,ApexBench 从 26.2 升至 36.5

【事件】8 月 31 日,DeepSeek-V4-Flash-Vision-Exp 的模型权重以 MIT 协议上线 Hugging Face。该模型 305B 参数、48 个 safetensors 分片,仓库体积约 168GB,是 V4 系列首个原生支持图片输入的实验性模型,此前已于 2026 年 8 月 21 日上线 DeepSeek API 平台。

【背景】模型卡给出的官方对比(对比前代 V4-Flash-0731 与 Opus-4.8):多模态侧 ApexBench Pass@1 为 36.5,高于前代 26.2、低于 Opus-4.8 的 39.4;Agents' Last Exam 27.3、Chartography 64.3、ZeroBench Pass@5 为 35.0。文本侧 Terminal Bench 2.1 为 83.9,略高于前代 82.7;NL2Repo 57.7 对 54.2、DeepSWE 59.3 对 54.4、Toolathlon-Verified 75.9 对 70.3。官方注明前代在 ApexBench 与 Agents' Last Exam 上会忽略输入中的多模态元素,因此这两项的分差不能直接读作同条件下的模型强弱。

【信号】该盯的不是分数而是工程可用性:官方明确当前放出的是便于理解模型结构的参考推理实现,非生产级服务引擎,尚未有推理服务商接入、也未公布定价,MIT 允许商用但 168GB 权重把落地门槛抬到多卡集群。反向风险是“Exp”定位下的能力边界尚未充分标注,OCR 精度、长图切片与复杂界面操作仍需自建验收。验证指标:第三方推理服务商接入时间、官方定价公布,以及社区独立复现的 ApexBench 分数。

模型与技术

MiniMax H3 Max 接入开放平台:5 秒 768p 音视频生成不到 3 秒,吞吐约为 H3 的 35 倍

【事件】8 月 31 日,MiniMax 宣布 H3 Max 768P 与 H3 Max 480P 接入开放平台和 MiniMax Design。H3 Max 由 fal 基于 MiniMax H3 开放权重版本做后训练与推理优化,支持文生视频与图生视频,可生成 480p 或 768p、5 至 15 秒、24fps 的完整音视频;生成一段 5 秒 768p 音视频不到 3 秒,15 秒视频约 15 秒完成,吞吐约为 H3 官方端点的 35 倍。

【背景】这轮加速来自模型与推理系统的同步改造:fal 在开放权重基础上加入新数据并用可验证强化学习优化指令遵循,同时针对自有推理基础设施适配,H3 Max 在 Artificial Analysis 与 Design Arena 图生视频榜单均居首位,Artificial Analysis 标价 2.40 美元/分钟。生态侧,FastVideo、Nuva Lab 与 NVIDIA FastGen 联合发布的 FastH3 把原生 H3 的 49 次 Transformer Forward 压缩到 4 次并结合 90% 稀疏度加速,8 张 B200 可在 13 秒内生成 15 秒 768p 视频,单张 Blackwell 上最高 14 倍加速。H3 开源三个多星期下载量超过 2400 万次、产生超过 300 个公开衍生模型。当日 MINIMAX-W 股价收涨 15.58% 至 347.20 港元,成交额 81.48 亿港元。

【信号】速度跨过播放速度的门槛后,视频模型的商业问题从「卖多少条」变成「维持多少并发」——直播与互动叙事这类场景需要模型长时间连续运行,成本随在线时长线性增长,而人物声音稳定性、画面一致性与接口持续调用能力仍是官方自陈的未验证项。反向风险在于榜单第一与商用毛利率之间还隔着推理成本:2.40 美元/分钟的定价能否覆盖并发峰值时的算力,要看到公司下一次财报的开放平台毛利率。验证指标:开放平台上 H3 Max 的调用量与单价变化、24 小时直播类应用的留存时长。

融资与并购

燧原科技确定科创板发行价 142.18 元/股、募资约 61.19 亿元,对应 2025 年摊薄后市销率 61.80 倍

【事件】燧原科技 8 月 31 日晚间公告科创板 IPO 发行价为 142.18 元/股,发行数量 4303.5173 万股,预计募集资金总额 61.19 亿元、扣除发行费用后净额 58.1 亿元,网上网下申购日均为 2026 年 9 月 2 日。公司尚未盈利,选择市销率作为估值指标,对应 2025 年摊薄后静态市销率 61.80 倍。

【背景】按发行价与发行数量计算,上市时市值约 611.87 亿元;本次发行占发行后总股本 10%,其中战略配售 860.7034 万股、占发行规模 20%,网上申购上限 6500 股。历史收入为 2023 年 3.01 亿元、2024 年 7.22 亿元、2025 年 9.90 亿元,三年复合增长率 81.32%;2026 年上半年营收 11.2 亿元,招股书预计 2026 年前三季度营收 23 亿至 30 亿元、同比增长 325.78% 至 455.36%,归母净利润 -8.60 亿至 -7.00 亿元,并称公司预计 2026 年或 2027 年实现合并报表盈利。技术上公司未跟随 CUDA 生态,自研全栈平台“驭算 TopsRider”;腾讯是燧原第一大客户和重要股东。

【信号】61.80 倍市销率低于同行业可比公司 2025 年静态市销率平均水平,是发行人主动留出的首日空间;同赛道的摩尔线程与沐曦股份上市首日收盘涨幅分别为 425.46% 与 692.95%。真正的反向风险在客户集中度——腾讯同时是第一大客户与重要股东,收入质量与关联交易比例需要在后续定期报告中持续验证。验证指标:9 月 2 日网上有效申购倍数、上市首日定价,以及前三季度 23 亿至 30 亿元收入指引的实际兑现区间。

AI 产品与战略

OpenAI Codex 活跃用户达 2500 万,全部付费订阅额度被重置

【事件】8 月 31 日,OpenAI Codex 产品负责人 Thibault Sottiaux 在 X 发文称 Codex 活跃用户数已达到 2500 万人(文中以“我昨日想说的是”回溯前一日表述),并宣布已重置 ChatGPT Work 与 Codex 全部付费订阅用户的使用额度。Codex 活跃用户在 8 月 21 日刚突破 2000 万。

【背景】这次重置并非永久提高套餐额度,而是把付费用户当前计费周期内已经消耗的使用量归零,使其可以重新使用完整额度;Sottiaux 未说明“活跃用户”的统计周期,也未披露免费与付费用户的占比,因此 2500 万不能直接理解为日活或月活。据三言科技转述,OpenAI 同时修复了 8 类导致 Token 异常消耗的漏洞,同等额度预计多支撑 10% 至 50%。此前 Codex 在 8 月中旬突破 1500 万活跃用户时重置过一次,一周后突破 2000 万又重置一次,两次之间间隔明显缩短。Codex 最初面向代码生成与开发任务,现已扩展到项目规划、代码修改、测试验证与长周期任务执行。

【信号】每 500 万用户一次全员重置,等于把额度做成增长里程碑的分发渠道:用户预期被固化后,取消重置会直接被视为变相涨价。反向风险是单位用户成本——重置意味着同一份订阅收入要承载更多 Token,若修复 8 类漏洞带来的 10% 至 50% 余量不足以覆盖增量,后续要么涨价要么降配。验证指标:下一次里程碑的时间间隔是否继续缩短、重置范围是否继续扩大,以及单位订阅的 Token 成本曲线。

行业格局

谷歌游说迪士尼、环球、华纳兄弟探索授权 IP 用于 AI 工具,业内称角色授权均价约 4000 万美元

【事件】据洛杉矶时报 8 月 31 日报道,谷歌高管已接触迪士尼、环球、华纳兄弟探索等制片厂,商谈将 IP 授权给 AI 模型使用,讨论范围包括制作环节使用谷歌 AI 工具、授权角色出现在 AI 生成内容中,以及用 YouTube 检测或变现合成内容。目前尚未达成任何协议,NBCUniversal 称未就 IP 授权与谷歌进行积极对话。

【背景】报价口径来自一位知情人:角色授权均价约每个 4000 万美元,100 个角色的交易规模达数十亿美元。交易结构上有两处阻力:一是 YouTube 曾要求加入其肖像检测计划的公司放弃起诉谷歌的权利,而迪士尼去年曾向谷歌发出停止侵权函,指控其未经授权使用迪士尼材料训练 AI;二是 SAG-AFTRA 全国执行总监 Duncan Crabtree-Ireland 表示,尚无主要制片厂按工会合同要求通知工会达成新的 AI 授权交易。谷歌已用 7500 万美元投资 A24,并与导演 Darren Aronofsky 的 Primordial Soup 建立合作,但这两笔与大制片厂谈判相互独立。

【信号】若按每个角色 4000 万美元的均价成交,训练数据的成本结构会被重写——版权方从诉讼索赔方变成按角色计价的供应商,AI 公司则把不确定性换成可摊销的采购成本。反向风险是这笔生意尚未闭环:工会通知义务与放弃起诉权两项要求都触及版权方的核心筹码,而知情人报价不等于成交价。验证指标:SAG-AFTRA 是否收到主要制片厂的 AI 授权通知、A24 之外的第一笔大制片厂协议,以及授权价格是否随角色热度分层。

数据看板

当日可核验的规模与金额

国产AI芯片缺口
100万颗 2026年需求约400万颗、实际交付约300万颗的差值
智谱上半年收入
9.54亿元 同比增长399.7%,同日纳入MSCI中国指数
燧原发行价
142.18元/股 对应2025年摊薄后静态市销率61.80倍,募资约61.19亿元
平安银行Token
53亿+ 上半年Token消耗量,同比增长约130%
Codex活跃用户
2500万 8月21日为2000万,每500万一次额度重置

验证与交付节点

2026年9月
星火端侧开源 · 9月1日开源X2.5-4B与1.7B,核对协议与1M上下文实测
2026年9月
燧原申购 · 9月2日网上网下申购,核对定价与首日表现
2026年9月
293B基座 · 9月7日发布星火X2.5(293B)基座模型
2026年12月
资源池报送 · 12月1日前报送服务商资源池,核对2000家目标成色

次重要信号速报

未来 7 天待观察

← 上一期(2026-08-30) 往期归档