英伟达 Vera Rubin 全面投产,Groq 3 LPX 每秒 3400 Token、Vera CPU 88 核入轨
据《Hot Chips 2026》《IT 之家》《新浪财经》报道,8 月 25 日,英伟达在 Hot Chips 2026 大会上宣布 Vera Rubin 平台全系产品进入全面投产:推理加速器 Groq 3 LPX 正式量产,单机架 256 颗 LPU,跑 Gemma 4 31B、10 万 Token 上下文可达每秒 3400 输出 Token;Vera Rubin NVL72 在 SemiAnalysis AgentX 智能体负载、DeepSeek V4 Pro 模型上每兆瓦吞吐量最高达上一代 GB300 NVL72 的 30 倍、每 Token 成本最高降 35 倍。同日发布的 Vera CPU 采用自研 88 核 Olympus 核心、空间多线程、1.2TB/s SOCAMM2 内存、164MB L3 缓存,SPEC CPU 2026 较 AMD EPYC 9755 单核领先 3%、智能体无头浏览器场景领先 24%,已被 SpaceXAI 规模化部署并计划送上近地轨道。电力效率取代峰值算力,正式成为 AI 工厂新货币。
OpenAI 自研推理芯片 Jalapeño 实测公开,每瓦 AI 工作量最高 1.9 倍于英伟达 GB300
据《Hot Chips 2026》《财联社》《OpenAI 官方博客》报道,8 月 25 日,OpenAI 在 Hot Chips 2026 首次公布首款定制推理 ASIC"Jalapeño"的基准测试结果。芯片由 OpenAI 与博通共同开发,采用 700W 功耗设计,首发 HBM4 内存,在 SemiAnalysis InferenceX 上跑 GPT-OSS 120B、DeepSeek R1、Kimi K2.5 1T 三个模型时,每瓦 AI 工作量达英伟达 GB300 的 1.5 至 1.9 倍、端到端延迟降低 1.7 至 3.6 倍。OpenAI 利用自身 AI 模型参与芯片设计,从设计到流片仅用 9 个月,计划 2026 年底小规模部署、2027 年扩大产量。叠加 9 月 29 日 DevDay 即将公布 GPT-6、Codex 周活 2000 万、Ultra Fast 14 倍加速,OpenAI 正从"模型公司"向"数据→芯片→模型→平台→产品→设备"全栈 AI 基础设施公司转型。
Anthropic 拟 9/10 月 IPO 估值 2 万亿,二季度年化收入 650 亿、调整后营业利润首次转正
据《观点网》《华尔街见闻》报道,8 月 25 日,AI 独角兽 Anthropic 正式启动首次公开募股筹备,目标估值 2 万亿美元以上,融资规模最高 1000 亿美元,有望刷新 SpaceX 此前 750 亿美元的 IPO 募资纪录。Anthropic 同步披露,2026 年 7 月年化收入达 650 亿美元,远高于 2025 年底 90 亿美元,二季度调整后营业利润首次转正,成为头部大模型公司中率先跨过盈亏平衡线的一家。但 Ramp 数据显示其旗舰 Fable 5 上线两个多月仅占总销售 11.4%,被性价比更高的 Opus 5 迅速反超,定价高且 30 天数据保留政策劝退部分合规敏感客户,2000 亿美元 2028 年营收目标面临考验。
Ilya 新模型或年底前亮相,SSI 持续学习突破被 a16z 预评为"年度最重要发布"
据《机器之心》《腾讯研究院 AI 速递》报道,8 月 25 日,a16z 合伙人 Martin Casado 公开透露已获得一款新模型访问权限,直指"今年最重要的模型发布,可去掉'之一'",多方线索指向 Ilya Sutskever 创立的 SSI。SSI 成立两年几乎零公开成果,却以无收入无产品之姿完成 20 亿美元融资、估值达 320 亿美元,获英伟达约 50 亿美元投资及最新 Vera Rubin 硬件支持。市场关注焦点是"持续学习"——若 SSI 真的攻克灾难性遗忘,大模型的训练、部署与更新方式将被重写,Ilya 描述的"15 岁少年"式超级智能构想将第一次拥有可落地的工程路径。
Harvey 法律 AI 独角兽基于 Kimi K3 后训练,Tenet 在 LAB 基准完成数近底座两倍
据《腾讯研究院 AI 速递》《36 氪》报道,8 月 25 日,美国法律 AI 独角兽 Harvey(估值 110 亿美元)发布首个基于开放权重后训练的模型 Tenet,底座采用月之暗面 Kimi K3,面向长时执行、连续调用工具的法律任务,在 LAB 法律 Agent 基准上的完成数近底座模型两倍。Harvey 的判断很直接:通用模型能答法律知识却难完成真实法律任务,稀缺的是"怎样做、怎样检查"的判断,只能靠训练传递,故独角兽宁用现成开放模型再加工。Cursor、Devin、Cosine、Thinking Machines 同样采用 Kimi 或 DeepSeek,中国开源模型正以底座、合成数据等形式进入美国 AI 产品供应链,这是"中国开放权重"在 2026 下半年最大的一次国际化样本。
苹果发布 M6 Mac mini 与 M5 Ultra Mac Studio,本地可跑万亿参数模型
据《新浪财经》《路透社》报道,8 月 25 日,苹果发布新一代 Mac mini 与 Mac Studio,搭载 M6、M5 Pro/Max/Ultra 四款芯片:Mac mini 起售 6999 元、Mac Studio 起售 19999 元,多款较前代涨价 500~1000 元。M6 是苹果首款 2nm M 系列芯片,AI 性能最高达 M4 4 倍、跑大模型提示词最高达 M1 13.5 倍,统一内存架构成为本地大模型关键;Mac Studio 可经 Thunderbolt 5 组集群做分布式推理,4 机最高达单机 3 倍,曾运行万亿参数 Kimi K2.6。同期,路透社援引三位知情人士消息称,苹果已为 iOS 中国市场训练专用大语言模型,与阿里巴巴合作完成,Apple Intelligence 预计在未来几个月随 iOS 更新在中国上线。
小米玄戒三芯齐发,O100 6nm 3D 堆叠带宽 1.22TB/s 破端侧内存墙
据《虎嗅》《每日经济新闻》报道,8 月 24 日小米玄戒技术沟通会发布三款芯片:端侧大模型加速芯片 O3(200 TOPS NPU)、国内首款 3nm 智驾芯片 D100、采用 6nm 3D 晶圆级堆叠的 O100(带宽 1.22TB/s、运行端侧模型推理速度最高 330 Tokens/s),构成"人车家 AI 算力底座"。但虎嗅评论指出,小米证明了 AI "能跑"却未回答"手机因何成为 AI 手机"——端侧算力就绪后,"应用墙"才是关键瓶颈。叠加新华社 8 月 25 日调研"AI 智能基座"产业兴起(上汽、广汽、小米、vivo 已采用国产端侧方案)、IDC 预测 2026 年非全彩 AI 眼镜占比将提升至 85%,端侧 AI 全栈方案正从单点竞争升级为生态竞速。
具身智能融资三连:小鹏 9 亿美元、Generalist 30 亿美元、简智 2 亿美元
据《投资界》《证券时报》《TechCrunch》报道,过去 24 小时全球具身智能赛道三笔标志性融资同步落地:小鹏集团旗下鹏行完成 9 亿美元首轮私募融资、估值 63 亿美元,IDG 资本领投 21 亿人民币,高榕、阿里、腾讯各 7.2 亿,刷新中国具身智能单轮纪录;前 Google DeepMind 与波士顿动力工程师 2024 年创办的 Generalist 凭 Gen 1.5 模型(可从 3~12 秒短视频学机器人任务)以 30 亿美元估值完成近 2 亿美元新融资、8VC 领投,Series B 累计 6 亿美元;北京简智机器人(无本体数据方向)完成 A 轮、Momenta 领投,成立一年累计 7 轮、融资超 2 亿美元,刷新该细分赛道融资体量。资本用脚投票,具身智能正从"概念演示阶段"切到"量产订单 + 通用模型 + 数据底座"三段式卡位。
中国支付清算协会首发《智能体支付应用自律公约》,划"KYA"红线与三级授权
据《华夏时报》《中国支付清算协会》报道,8 月 24 日,中国支付清算协会出台《智能体支付应用自律公约》并自发布之日起实施,这是中国首个针对 AI 智能体支付的全行业合规框架。核心机制包括:在 KYC 基础上建立"了解你的智能体(KYA)",对接入支付链路的智能体身份进行识别、验证与分级管理;明确交易限额、扣款账户、有效期等授权边界;账户管理、交易处理、资金清结算等核心环节必须由持牌机构开展;针对大额交易、跨智能体调用,审慎开展并设应急机制;为老年人、未成年人设置更审慎的风险提示与权限控制。背景是支付宝 AI 支付半年完成 3 亿笔,京东发布 L0~L5 智能体自主支付协议,微信支付、银联商务同步跟进——智能体支付正从"野蛮生长"转向"高质量、合规化"。
OpenAI GPT-5.6 Sol 二次降价 20%+、9 月 29 日 DevDay 聚焦 GPT-6 内部代号 Astra
据《北京商报》《IT 时代网》报道,8 月 25 日,OpenAI 把 GPT-5.6 Sol 输出价降至每百万 Token 20 美元,降幅 20%+,这是不到一个月内第二次降价;同日 OpenAI 宣布将于 9 月 29 日在旧金山举办新一届 DevDay 开发者大会,外界目光集中于内部代号 Astra、参数量或达 10 万亿的新一代大模型 GPT-6。Codex 负责人 Tibo 同步披露,Codex 周活已达约 2000 万、5 周前才 1500 万,Ultra Fast 极速模式最高可实现 14 倍生成加速,普通推理速度过去 3 个月提升约 60%,"ChatGPT 与 Codex 终将融合为单一个人 AGI"的方向已被明确。"降价 + 涨价"的双向剪刀差在美国一侧继续压缩前沿溢价,这是 OpenAI 在 GPT-6 正式发布前最关键的"留客"动作。
📝 整体评论
把过去 24 小时这十条铺到一张图上,最直观的感受是——AI 行业的"算力—芯片—模型—Agent—合规"五条战线,全部在这 48 小时内同时进入新阶段。英伟达 Vera Rubin 30 倍/35 倍、OpenAI Jalapeño 1.5-1.9 倍能效、Anthropic 2 万亿 IPO、Ilya SSI 年度最重要发布、Kimi K3 走进 Harvey、苹果 M6 本地万亿、小米三芯、具身智能三连融资、中国智能体支付自律公约、GPT-5.6 二次降价……任何一条单拎出来,都够 2024 年写一整周的资讯。
但热闹之下,真正的结构变化只有三件事:第一,AI 算力竞争从"谁的 GPU 峰值算力更高"全面转向"每瓦/每 Token/每美元能跑多少有效智能体任务",英伟达 Vera Rubin 30 倍/35 倍、OpenAI Jalapeño 1.5-1.9 倍能效、苹果 Mac Studio 4 机集群 3 倍,同一天落地的三件事本质都是同一句话——AI 工厂的新货币是电力效率,不是峰值 FLOPS;第二,大模型竞争从"前沿模型对前沿模型"分裂为"前沿闭源 + 开放权重 + 自研芯片"三段式军备,Anthropic 2 万亿 IPO + 650 亿年化 + 营业利润转正,意味着前沿闭源率先跨过盈亏平衡线,但 Ilya SSI + Kimi K3 + Harvey Tenet + Apple Intelligence 中国版,意味着"前沿"已不再是单一形态;第三,智能体从"演示性突破"进入"监管与商业化双向倒逼",中国支付清算协会《智能体支付自律公约》用 KYA 机制和三级授权给狂奔的 AI 支付踩下第一脚合规刹车,与 OpenAI ChatGPT + Codex 融合、Waymo 5nm 自研芯片、Meta Hatch 199 美元订阅,共同构成 2026 下半年 AI 产业"先合规、再扩张"的新节奏。
与之并行的还有三条暗线:英伟达同时打"推理(Groq 3 LPX)+ 端侧(Jetson Orin Nano 2)+ CPU(Vera)+ 太空计算(SpaceXAI)"四张牌,意味着 AI 芯片的"应用场景分层"开始取代"训练/推理"二分法,这是英伟达从 GPU 公司向"全栈 AI 基础设施公司"的关键转向;中国开放权重模型通过 Harvey、Cursor、Cosine、Thinking Machines 等垂直 AI 产品进入美国供应链,叠加苹果与阿里合作为中国训练专用模型,意味着"中国 AI"已从"国产替代"升级为"中美双向交换";具身智能三连融资用"量产订单 + 通用模型 + 数据底座"三段式,把小鹏、Generalist、简智同时推进"必须用真实任务证明价值"的成人礼,PI 联创 Levine 的"机器人仍在 GPT-2 之前"判断与资本市场 24 小时内下注 11 亿美元,形成 2026 下半年最具张力的反差。
中国一侧的信号同样清晰:小米三芯齐发 + AI 智能基座产业调研,代表端侧 AI 全栈方案正从单点竞争升级为生态竞速;中国支付清算协会《智能体支付自律公约》是继《生成式 AI 服务管理暂行办法》之后最具体的 AI 金融合规落地;人民日报《人民要论》提出中国引领 AI 全球治理的三重路径,与 EU AI Act 8 月 2 日 Article 50 强制执行、Digital Omnibus 把高风险 AI 延后到 2027-2028 形成"中国先合规—美国先融资—欧盟先延后"的三轨结构;阿里 800 亿港币 100% 投全栈 AI + 苹果阿里合作为中国训练专用模型 + 燧原科技 9 月 2 日 60 亿 IPO 申购,代表中国 AI 资本正以"芯片 + 数据 + 算力 + 终端 + 治理"五段式集中押注。
接下来 12 个月值得关注的 N 条主线:1) 英伟达 Vera Rubin + OpenAI Jalapeño 这套"每瓦/每 Token"新指标体系,能不能在 2027 年被 SemiAnalysis、MLPerf、InferenceX 第三方独立复现,若不能,两个厂内数据就只能当厂内数据;2) Anthropic 2 万亿 IPO 能否在 9-10 月如期落地,以及 2028 年 2000 亿美元营收目标在 Fable 5 销售疲软和 Opus 5 性价比反超后,如何重新平衡"前沿溢价 vs 性价比"的产品矩阵;3) Ilya SSI 年度最重要发布的真实身份是"持续学习"还是别的,以及若真攻克灾难性遗忘,大模型训练范式从"重训"到"持续更新"的工程化路径会是什么;4) 苹果 Apple Intelligence 中国版 + 阿里合训模型,2026 Q4 能否随 iOS 更新在中国上线,以及 6999 元的 Mac mini 是否真能承担本地大模型推理的"消费节点"角色;5) Kimi K3 → Harvey Tenet 这条"中国开放权重 + 美国垂直独角兽"链条,2026 Q4 会不会扩展到医疗、金融、教育领域,以及 DeepSeek、智谱、Qwen3.8 能否复制 Kimi 出海路径;6) 小鹏 IRON 2026 年底量产、Generalist Gen 1.5 真实工厂部署、简智数据底座开源进展,三家分别在 2026 Q4-2027 Q1 能否交出"真实任务成功率 + 单价 + 毛利率"三件套;7) 中国支付清算协会 KYA + 三级授权机制,2026 Q4 会不会扩展到证券、保险、跨境支付场景,以及智能体支付 L0~L5 协议(京东、支付宝、微信)如何在合规框架下继续产品化;8) EU AI Act Article 50 8 月 2 日已强制执行,中美 AI 公司在欧业务如何重新设计透明度披露,以及 Digital Omnibus 把高风险延后到 2027-2028 期间,GPAI 监管与"非自愿深度伪造"禁令的实际落地节奏。
