AI INDUSTRY CHAIN DAILY BRIEFING

AI 产业链每日简报 · 2026-09-30

数据窗口:2026-09-28 09:11 ~ 2026-09-30 09:11(北京时间) 筛选 14 条 / 数据池 830 条 侧重:产业链与算力经济
今日导览 —— 模型层以五分之一价格逼近旗舰(GPT-6.1 Sol),存储层把 121% 涨价写进 2027 年预期(TrendForce HBM)——量价对撞之下,Anthropic 招股书首次完整摊开 4000 亿级算力承诺的资本结构
高

高重要性 · 量价对撞

对当日产业链定价与资本结构有直接冲击、并将持续影响中期叙事的事件
来源:OpenAI 官网|DevDay 2026 超 20 项公告之一

OpenAI 在开发者活动日发布 GPT-6.1 Sol,官方称其在 agentic 编码、computer use 与专业工作上接近旗舰 GPT-6 Astra,标准 API 价格为每百万输入 token 2 美元、缓存输入 0.10 美元、输出 10 美元,约为 Astra 的五分之一;低推理强度下事实错误率从 GPT-6 Sol 的 11.4% 降至 7.7%。原定同期发布的更强版本 GPT-6.1 Astra 因安全隐患仍未推出。

为何值得关注:模型层"旗舰性能平价化"继续加速——被取消的 Astra 与降价的 Sol 同框出现,说明安全门槛开始直接决定供给节奏,而价格下探则在扩大 token 需求边界,两端共同加压推理算力与存储供给。
来源:IT之家(TrendForce 集邦咨询)

TrendForce 9 月 29 日大幅上调 HBM 内存价格展望,预计 2027 年平均价格同比上涨 121%。AI 服务器需求扩张下 HBM 与通用 DRAM 竞争有限产能,HBM4/HBM4E 占比提升推动价格上行;机构同时指出,部分企业转向评估低堆叠 8-Hi 方案,但其单位容量成本可能比 12-Hi 高 10~20%,堆叠层数调整难以扭转涨价趋势。

为何值得关注:机构把存储通胀从"方向判断"变成"数字定价"——121% 的年度涨幅预期直接改写 HBM 厂商 2027 年盈利模型;而 8-Hi 替代方案单位成本反而更高的结论,说明本轮涨价是产能结构性挤占,而非可通过降规化解的短期错配。
来源:IT之家(路透社/The Information)|IPO 目标估值约 2 万亿美元

Anthropic 保密版招股书显示,去年 47% 的客户销售收入经由亚马逊和谷歌云渠道完成;2025 年营收暴涨 12 倍至接近 46 亿美元,营业亏损超 80 亿美元。截至 2026 年初长期采购承诺总额超过 4,170 亿美元、对应 3.5GW 专用算力;其中对 SpaceX 的潜在算力账单最高达 845 亿美元,接近此前公开数字的两倍,提前 90 天通知可取消大部分支出。

为何值得关注:招股书首次把"模型公司—云渠道—算力供应商"的绑定关系完整量化:收入端近半依赖两大云渠道、成本端 4000 亿级采购承诺锁死未来数年现金流,渠道集中与算力承诺的期限错配是模型层商业模式的首次公开资本体检。
来源:IT之家|新紫光集团

新华三发布机架级全互联智算产品 UniPoD S81000 X1 超节点,单个 Scale-Up 域最大支持 40 张国产加速卡,任意两卡间 P2P 带宽达 448GB/s,40 卡聚合为 5760GB 统一编址显存池,总算力可达 28P FLOPS(FP8),兼容 19 英寸标准机柜、单柜最大部署 2 套 40 卡超节点。

为何值得关注:继华为 NPO 超节点、浪潮 SD200 Ultra 之后国产超节点阵营再添一员——对标 NVIDIA NVL72 的机架级 Scale-Up 竞赛在国内全面展开,448GB/s 互连带宽与统一显存池规格意味着国产互连方案正从"能用"走向"对标设计"。
中

中重要性 · 资本与生态

影响中期供给格局、技术路线卡位与算力资产定价方式的产业信号
来源:IT之家

NVIDIA 董事会批准向现有回购计划追加 1,500 亿美元授权,使总额达到 2,350 亿美元,为历史上规模最大的回购授权增幅,计划在 2028 财年内完成剩余全部回购。黄仁勋表示公司增长得益于向人工智能和加速计算的平台转型,充裕现金流支撑投资与股东回报并行。

为何值得关注:在市场争论"AI 资本约束"之际,英伟达用史上最大回购增幅投出信任票——硬件层龙头在 Capex 高峰期仍能产生足够自由现金流,与模型公司"亏损换增长"的资本结构形成鲜明对照,也是产业链内部人对算力需求持续性的定价。
来源:IT之家

创意电子(GUC)宣布其采用台积电 N2P 工艺的 HBM4E 物理层与控制器 IP 完成设计定案,并获得客户 AI ASIC 采用,支持 16Gbps 数据传输速率。该 IP 针对信号完整性与电源完整性优化,支持 CoWoS-S/R/L 先进封装,并提供专为 SoIC-X 设计、集成 TSV 结构的 face-up 版本以支持 3D 堆叠。

为何值得关注:HBM4E 接口 IP 已在 2nm 级工艺完成设计定案并进入客户 ASIC——下一代 HBM 的生态卡位从内存厂延伸到 IP 与代工环节,"先进制程+先进封装+HBM"的绑定在 2027 年放量前提前锁定。
来源:IT之家|总价约 703 亿韩元,2027 上半年流片

韩国芯片设计服务企业 SEMIFIVE 将为一家美国无晶圆厂 AI 芯片企业开发支持 LPDDR6、PCIe Gen5 的数据中心级推理加速器,订单总价约 703 亿韩元,为其史上最大单笔合同。该芯片预计 2027 上半年流片、2028 年量产,是 LPDDR6 成为 ASIC 片外缓存选择的早期案例之一。

为何值得关注:LPDDR6 进入数据中心推理 ASIC 设计——推理侧"以便宜内存换容量"的架构路线开始落地,若 2028 年量产验证成功,存储需求结构将从 HBM 一家独大转向"HBM+LPDDR 双轨",产能争夺格局更复杂。
来源:X:Rohan Paul

AI 云服务商 General Compute 定位"运行 NVIDIA 之外的一切",首个大动作为大规模采购 Cerebras 晶圆级系统,由 4 亿美元债务融资支撑。其方案将 Cerebras 与 NVIDIA GPU 并排部署、按请求拆分负载:GPU 负责读取提示词(Prefill),Cerebras 负责生成答案(Decode),利用各自架构优势。

为何值得关注:推理负载开始按"Prefill 计算/Decode 带宽"特性拆分到不同芯片——专用推理架构从演示走向生产组合;"债务融资买算力"模式若跑通,推理资产证券化将成为算力通胀的新增资金来源。
来源:IT之家(投行会议纪要)

英特尔代工总经理 Naga Chandrasekaran 预计 Intel 14A 与台积电 A14 两个 1.4nm 级制程节点的性能差距将在 5% 以内;Intel 18A 产能已接近每月 3 万片晶圆、性能介于台积电 N3 与 N2P 之间,14A 目前支持每月 1.4 万片产能。英特尔代工计划 2027 年底前实现盈利平衡。

为何值得关注:在台积电提价、EMIB 蚕食 CoWoS 的背景下,英特尔给出 1.4nm 追平的路线图——若兑现,AI 芯片客户 2028 年后将有真正的双源代工选择,先进制程环节的议价格局可能改写。
低

低重要性 · 边际信号

值得留意的长尾变化、技术路线早期样本与需求端佐证
来源:IT之家

月之暗面 API 后台模型注册表出现"kimi-k3-1"标识且接口可调用,官方开放平台同步出现 K3.1 预告,支持 1M tokens 上下文窗口,提供 Low/High/Max 三档推理强度,可能引入 Agent 模式与 Swarm 多智能体协作,API 价格与现有 K3 相同。

为何值得关注:1M token 上下文一旦普及,长上下文推理的 KV Cache 与存储需求将同步放大——模型能力升级持续向存储瓶颈传导,与当前存储涨价形成因果闭环。
来源:IT之家|10 月 9 日发售

极摩客(GMKtec)基于 AMD 锐龙 AI Max+ PRO 495 的桌面超算 EVO-X5 Pro 开启预约,最高配备 192GB LPDDR5X-8533 内存,官方宣称支持本地运行 320B 参数大模型,主打政务、医疗等涉密场景,具备独立 TPM 2.0 模块与全链路操作审计。

为何值得关注:端侧大内存路线下探到桌面级——192GB LPDDR5X 的商用量产设备放量,将与服务器争抢 LPDDR 产能,是存储通胀向端侧传导的具体样本。
来源:X:Arena

Arena 公布 Claude Sonnet 5.5(High)在 Code Arena: WebDev 以 1699 分排第 4,混合价格约 8 美元/百万 token,比第 2、3 名便宜 80%;相较 Sonnet 5(High)的 1540 分提升 159 分,在参考设计、仿真、游戏等子项表现突出。

为何值得关注:"便宜 80% 只差一名"的榜单证据与 GPT-6.1 Sol 的 1/5 定价相互印证,共同勾勒模型层通缩曲线的斜率——智能单位成本仍在快速下探。
来源:IT之家(韩媒)

SK 海力士驳斥其日本东北地区晶圆厂项目已启动基础工程施工的传闻,称"纯属无稽之谈"。尽管否认建厂进展,海力士近期已要求韩国零部件企业扩大供应,以应对内存短缺。

为何值得关注:辟谣建厂与催促供应链扩产同时出现——存储大厂在产能扩张上保持克制(客观上维护涨价环境),却让上游零部件先行备货,紧缺持续时间可能比市场预期更长。
来源:IT之家|DevDay 后采访

OpenAI CEO 奥尔特曼表示,只有能对模型安全作出站得住脚的承诺后才会考虑上市,目前没有确定时间节点;他担心上市后资本市场压力会妨碍安全优先的节奏,认为当下正处在向超高能力模型过渡、迎来全新安全要求的阶段。

为何值得关注:对照 Anthropic 已递交招股书,OpenAI 明确把"安全承诺"设为 IPO 前置条件——治理成本正在改写模型公司的资本时间表,上市窗口本身成为观测治理节奏的指标。

每日观点

郑希量价框架下的今日推演 · 2026-09-30
声明:本栏目为按郑希公开投资框架所做的推演,不代表其本人观点;引文均忠于语料原文并标注出处;全文仅供研究学习,不构成投资建议。

一、模型层通缩是传导机制,不是逻辑证伪

GPT-6.1 Sol 以五分之一价格逼近 Astra、Sonnet 5.5(High)以便宜 80% 的价格登上 Code Arena 第 4——"价"的坍缩在加速。但按量价框架,智能边际成本下降的直接后果是需求边界扩大:更便宜的 token 意味着更多任务值得被自动化,token 总量与长上下文使用(Kimi K3.1 的 1M 窗口是最新信号)同步放大,最终加压推理算力与存储供给。模型降价不是硬件通胀的对手,而是它的燃料。

"我比较在意的是一个产业的景气周期,更喜欢投资偏通胀属性的标的,譬如一些持续涨价的品种。我投资的最底层是研究清楚通胀从何而来。传统的周期行业通胀可能来源于纯粹的供需错配;偏科技成长的通胀更多是新技术落地带来的需求,是供给端创造的。后者的爆发力往往会更强,这也是我更偏爱的方向。"—— 郑希,2026 年 6 月接受中国证券报采访

二、存储链把通胀从新闻流写成定价表

TrendForce 给出 2027 年 HBM 均价同比 +121% 的数字预期;GUC 的 HBM4E 接口 IP 在 N2P 工艺定案并获客户采用;LPDDR6 进入数据中心推理 ASIC 设计;SK 海力士一边否认日本建厂、一边催零部件商扩供;192GB LPDDR5X 桌面超算开售。供给端每个环节都在用真金白银的资本决策回应紧缺——与昨日三星"HBM 占 DRAM 产能近 30%"的产能挤占形成连续证据链:涨价不是脉冲,而是写进产能配置表的结构性现象。

"AI投资导致全球半导体进入全面供给紧张阶段,晶圆厂Capex上修逐步成为行业必选项,半导体设备以及设备零部件大概率进入景气度提升阶段。"—— 郑希,2026 年基金中期报告

三、资本结构进入披露时代:渠道、账单与回购的三重奏

Anthropic 招股书把模型公司的资本底牌首次完整摊开:47% 收入依赖两大云渠道、4,170 亿美元采购承诺、SpaceX 账单最高 845 亿;同一窗口,英伟达追加回购至 2,350 亿美元、General Compute 用 4 亿美元债务融资采购 Cerebras。三种资本形态指向同一件事:算力资产的获取方式(股权承诺、现金回购、债务融资)开始分层定价,硬件层现金流与模型层烧钱模式的分化将持续加大。对组合的含义:方向变量(供给端通胀)未被证伪,节奏变量(渠道集中、治理延迟、融资成本)在增多——震荡阶段的应对是行业集中度管理,而非仓位撤退。

"我们将努力进一步优化组合,根据行业景气程度预判对组合进行行业集中度调整,展望2026年下半年,由于上半年涨幅较大,大概率市场进入震荡阶段。"—— 郑希,2026 年基金中期报告

四、本周跟踪清单

  • GPT-6.1 Astra 安全整改与恢复发布进度——Sol 过渡期的 token 用量弹性
  • HBM 2027 年 +121% 预期落地:三星/海力士/美光四季度合约价谈判与产能表态
  • Anthropic 路演定价:47% 渠道依赖与 4,170 亿美元承诺下的机构认购反应
  • 英伟达 10 月底财报:回购执行节奏与 Rubin 出货口径
  • 国产超节点(新华三/华为/浪潮)运营商与智算中心招标落地
  • Cerebras 等非 GPU 推理架构的债务融资规模是否继续扩大