英伟达联手 6 家顶级金融机构,砸出 5000 亿美元 AI 基建池

据路透社与《IT 时代网》8 月 11 日报道,英伟达宣布与阿波罗、贝莱德、黑石、布鲁克菲尔德、高盛、KKR 六家全球顶级金融机构签署谅解备忘录,搭建独立融资平台,计划随时间推移调动超过 5000 亿美元(约合人民币 3.38 万亿元)第三方资本,定向投入 AI 基础设施建设。黄仁勋在声明里把这桩合作定义为"AI 算力首次成为可投资资产类别",并透露英伟达可能为单个项目提供最高 25% 的残值支持,以压低金融机构的融资风险。平台不直接发放贷款,而是由合作机构独立评估项目,英伟达只出 AI 工厂技术栈、CUDA 生态和客户网络,长期资本由机构掏。消息落地后,黄仁勋口中"芯片作为创收资产"的叙事被市场视为 AI 泡沫争论的最新注脚:泡沫与否另说,至少说明算力生意已经具备了"被证券化"的体量。


Grok 4.6 上线,马斯克晒 48 小时徒手做出多人射击游戏

据《TechCrunch》与新浪科技 8 月 12 日报道,SpaceXAI 推出最新旗舰模型 Grok 4.6,在第三方测评平台 Artificial Analysis 智能指数上并列全球第三,仅次于 Anthropic 的 Fable 5,与 OpenAI 的 GPT-5.6 Sol 处于同一档。马斯克同日在 X 上传一段硬核实测视频,称 Grok 4.6 在零人类工程师干预下,连续自主运算 48 小时,完成了游戏引擎配置、物理碰撞逻辑、三维资产渲染与多关卡调试,直接交付一款可运行的多人射击游戏。SpaceXAI 强调这次升级"底座模型没换",主要靠后训练阶段的反复自我检验,把 Agent 长链任务的成功率提上来;定价维持每百万输入/输出 Token 2 美元/6 美元,比 Claude Fable 5 和 GPT-5.6 Sol 低 60% 以上。马斯克两小时内连转约十条推文为新模型站台,留言区涌进数十万程序员,有人高呼"独立游戏开发门槛被踩平",也有人担心初级开发岗位正在被算法无声抹杀。


Anthropic 全面部署 Claude 文本水印,欧盟 AI 法案 8 月 2 日生效后首批落地

据 Anthropic 官博与《TechWeb》8 月 16 日消息,Anthropic 宣布 Claude 模型全面部署文本水印技术,成为欧盟《人工智能法案》AI 生成内容标记要求生效后首批合规的 AI 提供商之一。技术原理并不神秘:模型在选词时不再用任意随机数,而是依赖一把特定密钥和前文若干 token 来做决策,生成的词序列会携带可检测的统计模式,持密钥的检测方可以反算文本由 Claude 生成的概率,普通读者完全无法察觉。Anthropic 强调水印不含任何身份信息,"不能用来追溯到任何个人、组织或对话历史";在事实性陈述、代码生成等"低自由度"场景下水印附着空间有限,但翻译、长文等场景效果充分。Google DeepMind 在 SynthID-Text 论文里给出的对照研究显示,带水印与不带水印版本的赞踩比无统计学差异,质量评分无差异——水印的代价,基本就是没有代价。


DeepSeek V4 Pro 涨价最高 11 倍,Harness 框架同步开源,GitHub 飙到 9.5 万星

据新京报 AI 研究院 8 月 13-15 日实测,DeepSeek 正式发布 V4 Pro 正式版并宣布 API 调价:高峰时段(9:00-12:00、14:00-18:00)输入价格最高涨至原来的 12 倍、输出价格涨 4.5 倍,新价格自北京时间 8 月 17 日 0 时起生效。同日深夜,DeepSeek 还开源了 Agent 框架 DeepSeek Harness v0.1(MIT 协议),定位直接对标 OpenAI Codex 和 Anthropic Claude Code,核心设计理念是"一切皆插件",基于 Cordis 插件系统构建——模型、工具、技能、会话、循环、调度、UI 全是插件,可以在配置层自由组合。GitHub 数据显示,项目上线后 24 小时内 Star 数突破 9.5 万,fork 数 8.8k,被文渊智库创始人王超解读为"DeepSeek 不再满足于只卖模型,开始抢占 Agent 运行底座的开发者入口"。外界普遍认为,DeepSeek 已经从"价格屠夫"正式转身为"舞台搭建者"。


OpenAI 一周内两高管离职,IPO 关键期遭遇"成立来最剧烈高层震荡"

据 CNBC 8 月 14 日报道,OpenAI 在一周之内连失两员大将:8 月 11 日,任职八年的元老级 COO 布拉德·莱特卡普宣布"开启新事业";8 月 13 日,入职不满一年的首席营收官丹尼斯·德雷瑟也宣布离职,交由原网络安全公司 Wiz 总裁兼 COO 达利·拉吉奇接任。加上 7 月因健康原因退居二线的应用业务 CEO 菲吉·西莫,短短一个月内 OpenAI 已经历三次核心管理层人事变动。关键背景是,OpenAI 今年 6 月已秘密向 SEC 提交 IPO 招股说明书,3 月最新一轮融资后估值高达 8520 亿美元。SignAudit.AI 创始人凯文·麦考密克直言"IPO 前出现大量高管离开是一个值得关注的信号",但 OpenAI 投资人则普遍把这轮动荡解读为"快速招聘、快速淘汰"文化的延续。8 月 16 日,OpenAI 又宣布与 Chad Peets 及 RPT Partners 合作搭建 GTM 团队,为 200 万企业客户的下一步扩张铺路。


OpenAI 内部 Slack 曝光:ChatGPT 加载飙升 94%,多智能体 v2 全量上线

据新智元 8 月 15 日报道,OpenAI Codex 负责人 Andrew Ambrosino 在内部 Slack 群组公开了一组数据:针对一个 741 轮、231 MB 的"怪物级"长对话,ChatGPT 加载时间从 27.62 秒降至 1.66 秒,网络请求从 894 次砍到 16 次,内存增长从 1030.7 MiB 压到 606 MiB,加载的会话条目从 15529 条降到 64 条——应用加载速度整体飙升 94%。同一天,OpenAI 工程师 Eric Provencher 正式宣布:多智能体 v2(Multi-Agent v2)已全量上线,主 Agent 可自动把子任务委派给 Sol、Terra、Luna 等不同模型,每个子 Agent 都能独立设置推理强度,用户再也不用手动选 GPT 了。OpenAI 总裁 Greg Brockman 用一句"告别手动选模型"为这套体系定调——"过去要靠人判断哪步用哪档模型,现在模型自己调度模型,复杂任务 20% 步骤用最强模型、其余交给便宜模型,推理成本被结构性压下来"。


英伟达被迫砍半 OpenAI 数据中心担保:2500 亿缩水到 1200 亿

据《华尔街日报》8 月 15 日报道,英伟达与 OpenAI 即将就俄亥俄州一座超大规模数据中心的融资达成协议,但交易结构被改写——英伟达原本承诺的 2500 亿美元财务担保,在投资者施压下被砍到不足 1200 亿,缩水超过一半。消息人士透露,投资者担心英伟达用自身信用为 OpenAI 远期扩张背书会带来过大的风险敞口,英伟达于是收缩了担保范围,目前只覆盖第一期约 5 吉瓦的容量;整个 10 吉瓦项目的剩余部分,OpenAI 得自己想办法筹资。英伟达还在另谈一笔总额最高 3500 亿美元的 OpenAI 芯片采购融资,但风险敞口明显被重新审视。The Decoder 评价:"英伟达自己先给远期扩张踩了一脚刹车,这是给 AI 泡沫争论递了新弹药——连 AI 繁荣的最大受益者,都开始变得更谨慎。"


腾讯 Q2 资本开支 527 亿同比涨 176%,AI 投入直接吃光利润增长

据腾讯 8 月 12 日发布的 2026 年第二季度财报,公司当季营收 2047.85 亿元,同比增长 11%、环比增长 4%;但归母净利润仅 560.22 亿元,同比增长 0.7%。腾讯总裁刘炽平在业绩沟通会上承认,利润端几乎停滞的核心原因,是 AI 驱动的高额资本开支——单季资本开支 527.84 亿元,同比增长 176%,导致本季录得 138 亿元负自由现金流。这笔钱的去处很清晰:支持混元大模型升级、WorkBuddy 与 CodeBuddy 的推理需求、微信 AI 项目落地,以及满足外部客户对云服务持续增长的需求。财报次日,腾讯港股跌超 4%,反映出市场对"AI 投入能否转化为收入"的明确焦虑。刘炽平回应称"本轮集中投入以今明两年为主,后续将依据收益动态控制规模",但没说盈利模型怎么跑通。


智谱发布 GLM-5.3:编程体感再提 50%,网络安全能力超预期,开源推迟

据智谱 8 月 14 日官方消息,智谱发布旗舰模型 GLM-5.3,主攻复杂编程、长程智能体和网络安全三大方向。智谱内测数据显示,GLM-5.3 的编程体感较 GLM-5.2 提升 50%;在从源代码出发识别并验证漏洞的 CyberGym 测试中,得分略高于智谱同步列出的 Anthropic Mythos 5(83.8)与 OpenAI GPT-5.6 Sol(83.6)。智谱官方称其在编程与智能体能力上接近 Claude Fable 5,但与上一代 GLM-5.2 共享同一个 743B 基座,能力提升主要来自后训练阶段的大规模强化学习——典型意义上的"后训练红利"。值得注意的是,智谱宣布 推迟公开权重,理由是模型的网络安全能力增长快于预期,需先控制被滥用于网络攻击的风险。这一选择与 7 月 7 日欧盟出台的《网络安全与人工智能行动计划》直接呼应,也算是国内大模型厂商在合规上的第一次主动出牌。


Anthropic 拿 Claude 攻黎曼猜想:虽未成功,但把已知下限从 41.6% 提到 67.2%

据 Anthropic 8 月 11 日在 X 上的官方帖文,研究版 Claude 尝试证明黎曼猜想未能成功,但模型将一项相关结论(黎曼 ζ 函数零点比例的下界)的已知最优结果从 41.6% 提升到了 67.2%,刷新了此前的纪录。这次突破的关键,不是 Claude 直接"想到了答案",而是用 Claude Code 搭起了一套多 Agent 流水线:用形式化证明语言 Lean 写脚本、调用数学文献搜索工具、跑数值实验、生成可审查的证明草稿,然后让一个评审 Agent 反复挑刺,最后人类数学家只对关键步骤把关。换句话说,AI 没证明黎曼猜想,但它把"AI 数学发现"这件本来只属于顶尖实验室的事,做成了一条可复现、可审计的流水线——这件事本身的意义,可能比一个具体的数学结果更大。


📝 整体评论

过去 48 小时,整个 AI 行业看起来像是在同时做两件相反的事:一边是 5000 亿美元融资池、527 亿单季资本开支、200 万企业客户这种"all-in 算力"的豪赌,另一边是英伟达把 OpenAI 担保砍半、DeepSeek API 涨价 11 倍、Anthropic 推迟开源 GLM-5.3 同类"高风险被快速定价"的刹车。两股力量撞在一起,本质上是同一道题的两种答案:当智能指数、Agent 能力、模型基座都在以季度为单位向前推进时,基础设施侧是否愿意继续以指数级的方式,提前为这些能力买单?

OpenAI 高管震荡和腾讯利润吃光的故事,只是这道题的国内国外两个注脚:一个把"管理带宽"当成最贵的稀缺资源,一个把"现金流"当成最贵的稀缺资源。OpenAI 答法是赶紧换帅并请 GTM 顾问进场,腾讯答法是承诺"今明两年集中投入,后续依据收益动态控制规模"——两种答法都没有说服市场,但都说明一件事,AI 已经不是那个可以靠"先跑起来再说"取胜的行业了

同样有意思的是 Grok 4.6 和 DeepSeek Harness 的"产品形态"分化。Grok 4.6 选择把能力外化成"48 小时做出一款完整游戏"这种可被看见的强演示,DeepSeek 选择把能力沉淀成"一切皆插件"的工程底座。前者卖的是"用 AI 的震撼",后者卖的是"用 AI 的工程现实"——两条路都不是旧问题,但都指向同一个判断:2026 年下半年,模型之间的差距在快速收窄,真正决定胜负的是怎么把模型接进真实工作流

值得记录的还有几件不那么显眼的事:Anthropic 在欧盟 AI 法案生效两周内就把水印技术部署到所有 Claude 模型、Anthropic Claude 用多 Agent 流水线把黎曼 ζ 下界刷到 67.2%、智谱 GLM-5.3 在 CyberGym 上反超同档对手、OpenAI ChatGPT 多智能体 v2 上线后让用户"告别手动选模型"——这些都不是"重大模型发布",但合在一起说明,AI 行业的竞争维度正在从"谁更聪明"悄悄切换到"谁更可信、谁更稳、谁能落到工作流里"。

接下来 12 个月值得关注的 5 条主线:一是 AI 基建融资的工具化,5000 亿平台能不能从单点案例变成可复制的金融产品,决定这一轮算力扩张是阶段性还是结构性的;二是 Agent 底座的护城河之争,OpenAI Codex、Anthropic Claude Code、DeepSeek Harness 之间的开发者入口争夺,可能比模型本身的智能指数更重要;三是 模型后训练红利的可持续性,Grok 4.6 / GLM-5.3 / GPT-5.6 都是"不换底座、只换后训练"就拿到能力跃迁,这对算力供需关系是重大变量;四是 合规成本向厂商侧的转移,欧盟水印、智谱推迟开源、Anthropic 的供应链风险认定案,都在把"安全/合规"从行业自律推向法定要求;五是 AI for Math / Science 流水线化,Anthropic 这次黎曼 ζ 实验如果被复现,意味着"AI 出数学结果"将从单点突破变成可批量复制的科研工作流,高校和大公司的研究院都需要重新评估自己的研究-评审链条。

ai-daily-cover

发表评论