🔦 今日速览
9 月 13 日(周末合辑),中国 AI 大模型融资再掀高潮:智谱宣布完成约 50 亿美元融资,距其 7 月 40 亿美元配售仅隔两个月,海外机构成为绝对主力;上海浦江论坛同日启动"明珠星座"天基算力计划。中国算力大会披露我国智算规模已达 2185 EFLOPS,优必选工业人形机器人万台级工厂在柳州投产。前沿模型竞争方面,GPT-6 Astra 在两项智能体基准测试中以约 3 倍优势领先 Claude Fable 5.1。
趋势1:大模型竞赛进入资本与算力深水区 趋势2:算力基础设施从地面延伸到太空 趋势3:具身智能迈向万台级量产
🌍 国际动态
1. GPT-6 Astra 智能体基准约 3 倍领先 Claude Fable 5.1
事件简述:独立评测机构 Andon Labs 对 OpenAI 的 GPT-6 Astra 与 Anthropic 的 Claude Fable 5.1 进行两项智能体基准测试。在模拟自动售货机经营任务中,Astra 六次运行平均期末余额 15515 美元,约为 Fable 5.1(5422 美元)的三倍,且六次成绩全部高于 Fable 的最佳单次(9874 美元)。
关键数据:在 Drone-Bench 无人机编程基准中,Astra 成为首个在全部五项子任务上均超越"人类-AI 协同"基线的模型,但端到端成功率仍待提升。
影响分析:两大前沿实验室在长周期自主经营与物理系统编程上的能力差距正在拉大,智能体的"经济价值"与"安全对齐"首次有了可量化的横向标尺。
📅9月13日
2. 中美 AI 对话前,美智库呼吁"为前沿 AI 降速"
事件简述:美国进步中心(CAP)发布报告,建议中美在本月的人工智能安全对话中,讨论对前沿 AI 进行"节奏控制"。报告指出任何一方单独放缓研发都面临落后压力,而先进 AI 一旦失控其危害将跨越国界,因此双方需在竞争中寻求安全合作,区分技术竞争与真正的安全威胁。
关键数据:报告提出建立"AI 红线电话"、界定真正安全威胁等五项建议;美方代表团将由财长贝森特率领,中美两国领导人计划当月晚些时候会晤。此前 Anthropic CEO 已公开呼吁行业放缓模型能力提升,马斯克与奥特曼相继背书。
影响分析:从实验室"安全减速"表态到智库"节奏控制"框架,"放慢前沿"正从中美 AI 企业的内部呼吁,升级为拟议中的双边治理议题,为全球前沿模型研发设置潜在的政策天花板。
📅9月10日(报告发布)
🇨🇳 国内动态
1. 智谱两个月内再融 50 亿美元,海外机构成绝对主力 ⭐
事件简述:9 月 13 日,智谱(02513.HK)宣布完成约 50 亿美元(约 335 亿元人民币)融资,由约 20 亿美元股份配售与约 30 亿美元零息可转债构成,距其 7 月约 40 亿美元配售仅隔两个月。配售价每股 714 港元(较收盘价 793 港元折让约 9.96%);可转债初始转股价 892.50 港元,较配售价溢价 25%。
关键数据:本轮资金约 60% 投向下一代 GLM 基础模型与"完全自训练"体系、算力基础设施,15% 用于业务拓展与战略投资,25% 用于资本结构及营运资金。来自亚、欧、美的海外机构成为绝对主力——近 30 家长线机构参与,多家单家需求超 5 亿美元,前 20 大机构获配股本超 85%。2026 上半年智谱营收 9.54 亿元、同比增 399.7%,开放平台及 API 收入 8.25 亿元、同比增长 2736%。
影响分析:这是国产大模型头部玩家两个月内的第二次大规模融资,且以"零息 + 溢价转股"结构锁定长期资金,标志大模型竞争从"模型能力与榜单"全面转向"资本实力与算力供给"的持续投入能力较量——留在牌桌中央的前提,是具备在算力、模型、商业化上持续复利的能力。
📅9月13日
2. 上海启动"明珠星座",2030 年建成吉瓦级天基算力网
事件简述:9 月 13 日,2026 浦江创新论坛"太空算力产业生态论坛"上,上海"明珠星座计划"正式启动,目标建设吉瓦级天基计算星座,围绕国产算力载荷、光计算载荷、新型能源系统开展在轨验证,计划 2030 年建成全球覆盖、天地协同、自主可控的太空智能算力基础设施。
关键数据:东方天算与中科院微小卫星创新研究院、上海空间电源研究所、阿里云、科大讯飞、壁仞科技、天数智芯等 27 家产业链伙伴签署合作协议,覆盖算力芯片、空间能源、星间通信、卫星平台等环节。
影响分析:把 AI 算力基础设施从地面数据中心延伸到太空,是"算电协同"之后中国算力"上天入地"布局的又一信号——在土地与电力约束日趋紧张之际,天基算力为 AI 基础设施提供了新的空间维度与政策叙事。
📅9月13日
3. 我国智算规模达 2185 EFLOPS,竞争焦点转向"有效算力"
事件简述:2026 中国算力大会(9 月 11—13 日,河北廊坊)披露,截至今年 6 月我国智算规模达 2185 EFLOPS(FP16),同比增长 177%。大会高频词从"堆规模"转向"有效算力"。
关键数据:信通院指出全国仅 7 省智算上架率超 75%,电力、液冷与运维能力正取代机柜规模成为数据中心价值核心;中国电信总经理刘桂清提出深化"算电协同"、加快算力互联互通、提升国产算力效能三点倡议。
影响分析:规模数据高增掩盖了利用率的分化——当"上架率"和"有效算力"取代"总规模"成为关键词,行业正从粗放扩张进入精细运营阶段,电力供给、跨域调度与国产算力适配将成为下一阶段的核心瓶颈。
📅9月13日
4. 优必选柳州超级智慧工厂投产,人形机器人迈向万台级量产
事件简述:9 月 12 日,优必选工业人形机器人超级智慧工厂在广西柳州投产,占地 1.4 万平方米,主要生产 Walker S 系列与 Cruzr 系列工业人形机器人,号称全球首个适配万台级产能的工业人形机器人智能制造标杆工厂。
关键数据:工厂每 10 分钟下线 1 台机器人,年规划产能超 1 万台。
影响分析:人形机器人正从"样机展示"走向"万台级量产",供应链零部件、产线设备与工业场景落地需求有望随之放量,也印证近期"物理 AI 将率先在仓储物流与汽车制造规模化"的行业判断。
📅9月12日
📄 今日论文
1. Thinking with Looped Flows:让"循环思考"可训练
作者:Ayhan Suleymanzade, Chanhyuk Lee, Floor Eijkelboom, Nicholas M. Boffi et al. 核心贡献:提出"looped flows"方法,用局部去噪目标训练循环模型的隐状态更新——通过逐步降低噪声水平并共享噪声,促使模型学习随时间传递有用计算的循环状态,避免反向传播只覆盖少数几步更新的训练难题;推理时将其表述为概率流的速度积分,让"多花思考时间"的循环模型更可训练。 为什么重要:呼应业界"思考越多、能力越强"的慢思考探索,为把"思考时间"从推理期工程技巧变成可训练机制提供了新的理论路径。 📄 arXiv:2609.11801 📅9月10日
2. LOCUS:任务感知的低秩后训练,让大模型"少说点废话"
作者:Dongfang Zhao 核心贡献:研究后训练参数化方式如何影响生成长度——低秩子空间能在不改变对齐损失的前提下改变回答长度。LOCUS 在冻结主干上选择任务感知的低秩适配子空间,在效用约束下最小化输出 Token 成本。在 Anthropic HH-RLHF 上,Pythia-2.8B 续写长度最多缩短 39.84%,Qwen2.5-3B 缩短 14.87%—17.58%。 为什么重要:在"词元经济"成为显性成本(中国 Token 年消耗量预计 2026 年达 10 亿亿)的当下,从训练端直接压缩输出长度,为模型厂商和调用方提供了"降本不降质"的新抓手。 📄 arXiv:2609.11739 📅9月10日
3. Logit Refiner:修复视觉自回归模型的"局部碎裂"
作者:Meimingwei Li, Stefan Andreas Baumann, Felix Krause, Björn Ommer 核心贡献:指出视觉自回归模型(VAR)的并行解码近似"平均场",丢弃了同尺度 Token 间的空间依赖,导致局部画面不连贯。提出的 Logit Refiner 是轻量自回归模块,在冻结主干特征上顺序采样以恢复尺度内依赖,仅增加约 10% 参数、不到 5% 训练算力,即可即插即用接入任意预训练 VAR 模型。 为什么重要:以极低成本修复主流视觉生成模型的通病,为多模态图像生成在高效率与高连贯性之间找到新平衡,对追求"低成本高质量"的多模态模型有直接借鉴意义。 📄 arXiv:2609.11804 📅9月10日
4. 统一逐 Token 门控蒸馏:区分"知识迁移"与"越界复制"
作者:Suwan Wu, Yumeng Lin, Pengcheng Yuan, Xiaolong Jiang 核心贡献:把 on-policy 蒸馏中现有的 FKL/RKL 门控方法统一到一个四系数参数化框架(含多通道组合与显式偏置),在 TweetEval 情感与仇恨任务上,Qwen3-32B 教师指导下 Qwen3-4B 学生较单通道方法在 33/36 组对照中取得更高准确率。 为什么重要:在 Anthropic 指控中国公司"非法蒸馏"之际,此文提醒行业"蒸馏"作为合法技术本身仍在快速演进——如何划分正当的知识迁移与越界的模型复制,是比技术更值较真的合规问题。 📄 arXiv:2609.11768 📅9月10日