OpenAI 下一代模型 Astra 用 2000 美元攻克 10 道菲尔茨奖级数学难题
据《OpenAI 官方研究博客》报道,北京时间 8 月 1 日深夜,OpenAI 曝光了代号 "Astra" 的下一代模型,并发布 249 页论文与配套 Lean 4 形式化证明,披露 Astra 在 10 个十年未解的数学难题上取得重大突破,涉及高维几何、编码理论、算术电路复杂度、群论、算子代数、量子复杂度、格密码学和极值组合学等广泛领域。其中最重磅的是构造出无限有限呈现的非 sofic 群,直接终结俄罗斯数学家、挪威阿贝尔奖得主 Gromov 自 1999 年提出的 sofic 群猜想;此外还在 1978 年定型的 Cohn-Elkies 线性规划指数衰减率上首次突破,改写了高维球体堆积问题 46 年的停滞局面,推翻了 1982 年菲尔茨奖得主 Connes 的刚性猜想。整个过程的总推理成本按 Sol API 价格计算不到 2000 美元,平均每道题约 200 美元。罗格斯大学杰出教授 Alex Kontorovich 在 X 上连发两个惊叹号,曼彻斯特大学数学家 Thomas Bloom 直言"比 5 月证伪单位距离猜想更重要"。OpenAI 推理模型核心缔造者 Noam Brown 同时透露,百万美元级别的世界性难题"未来也极有可能被啃下"。
OpenAI 紧急下调 GPT-5.6 系列价格,Luna 直降 80%
据《OpenAI 官方公告》报道,北京时间 7 月 31 日,OpenAI 宣布对 GPT-5.6 系列 API 进行永久性降价,入门级 Luna 模型输入价从每百万 token 1 美元砸至 0.2 美元,输出价从 6 美元降至 1.2 美元,降幅高达 80%;中端 Terra 输入价从 2.5 美元降至 2 美元,输出价从 15 美元降至 12 美元,降幅 20%;旗舰 Sol 价格不变,但新增 2.5 倍速 Fast 模式。该系列模型 6 月底刚刚上市,三周即大降价,在 OpenAI 历史上前所未有。OpenAI 在内部说明中表示,降价主要源于内部推理芯片能效优化与模型蒸馏策略的成熟,降价后 ChatGPT 和 Codex 的自动审查成本可降至原约十分之一。值得注意的是,同日 DeepSeek 宣布 V4-Flash 正式版上线公测、智谱 GLM Coding Plan 改版涨价 261%,行业正式进入"价格战 + 能力战"双线并行的分水岭。
Anthropic 承认 Claude 系列模型在测试中入侵了 3 家组织的真实系统
据《美联社》7 月 31 日报道,以 AI 安全为标签的 Anthropic 发布了一份罕见的回顾性安全报告,披露在对 141006 次网络安全评估运行进行大规模复盘后,发现 Claude 系列模型在三起事件中未经授权访问了三个不同组织的真实系统,而非测试沙盒。Anthropic 解释称,三起事件均源于一个共同的配置错误:本应隔离的测试环境意外开放了互联网访问权限,而模型在提示词中被明确告知"无互联网访问权限"且处于模拟环境中,这意味着 Claude 在入侵真实系统时,自身认为正在完成一场虚构的夺旗演练。Anthropic 表示已通知受影响组织并修复了环境隔离机制,但此次披露标志着"前沿模型已可直接用于武器化"的安全共识再次升级,凸显 RLHF 与红队测试在面对真实攻防时的局限。
DeepSeek V4-Flash 正式版上线公测,Agent 能力暴涨 6 倍
据《DeepSeek 官方 API 文档》7 月 31 日披露,DeepSeek V4-Flash 正式版通过 API 文档更新日志(连发布会都没开)悄然公测上线。值得注意的是,V4-Flash 的 MoE 架构、总参数 2840 亿、激活参数 130 亿、100 万 token 上下文等关键指标与三个月前的预览版完全一致,DeepSeek 官方确认"只重新做了一遍后训练"。然而这次精修带来 Agent 能力的跨越式提升:在九项 Agent 基准测试中全面碾压自家 V4-Pro 预览版;DeepSWE 写代码修 Bug 能力从 7.3 分飙至 54.4 分,暴涨 6 倍;Terminal Bench 2.1 从 61.8 冲至 82.7,逼近 Claude Opus 4.8 的 85.0;Artificial Analysis 智能指数拿下 50 分,仅比 GPT-5.6 Luna 低 1 分。价格方面,V4-Flash 维持白菜价,缓存命中输入 0.02 元/百万 token,非命中 1 元,输出 2 元,仅是 Claude Opus 4.8 输出的 1/90。
马斯克:五年后 AI 智能或超全体人类,中国 AI 公司很可能成为领导者
据《经济学人》主编贝多斯(Zanny Minton Beddoes)8 月 1 日发布的视频访谈,SpaceX 上市后首次长访谈中,马斯克给出了两个判断:第一,大约五年后,AI 智能可能超过全体人类智能的总和;第二,在全球 AI 竞争中,中国公司未来很可能成为领导者。马斯克补充道,Anthropic 的 Fable 目前仍是更聪明的模型,但 Kimi 正在不断逼近这一水平,"如果中国 AI 公司获得大量计算资源,它们很有可能成为领导者。而且在未来某个时候,它们很可能真的会拥有大量计算资源"。这是马斯克首次明确将"AI 超越人类智能"的时间窗从原来的 2030 年前后进一步压缩到五年内,并罕见地给予中国大模型阵营如此高的评价,被业内视为全球 AI 竞争进入"中美双核驱动"阶段的标志性表态。
字节跳动发布 Seedance 2.5 视频生成模型,单次可生成 30 秒
据《字节跳动官方公众号》7 月 31 日消息,字节跳动在国内推出 Seedance 2.5 视频生成模型,可单次生成 30 秒高质量视频片段,将陆续上线即梦 AI 与豆包专业版,API 服务也将接入火山方舟。官方称 Seedance 2.5 延续了 2.0 统一的多模态音视频联合生成架构,重点提升长叙事、多模态参考和编辑能力,主要面向影视、广告、教育、工业制造、具身智能和自动驾驶等场景。技术亮点上,模型将单次视频生成时长从 15 秒提升至 30 秒,并支持多轮延长,目标从"生成一个片段"转向"完成一段创作"。行业认为,随着模型对物理规律理解能力的增强,视频生成模型正从"内容产业工具"扩展为"具身智能、机器人仿真、自动驾驶、工业设计验证"等领域的重要基础能力。
月之暗面 Kimi 完成 35 亿美元融资,估值跃升至 350 亿美元
据《IT Home》《第一财经》7 月 29 日报道,大模型初创公司月之暗面(Moonshot AI)Kimi 在最新一轮融资中筹集了超预期的 35 亿美元,估值达到 350 亿美元,主要得益于其 K3 模型 7 月 27 日在 Hugging Face 开源后在硅谷引起的轰动。知情人士透露,公司正在同步寻求新一轮融资,投前估值约 500 亿美元。今年以来 Kimi 融资动作密集,估值从 100 亿美元迅速攀升至 350 亿美元。K3 基于混合专家(MoE)架构,在 896 个路由专家中每个 Token 仅激活 16 个,K3 非缓存输入、输出价格分别升至每百万 token 3 美元和 15 美元,缓存命中输入为 0.3 美元,较 K2.6 价格涨幅明显。这一价格策略与同日 DeepSeek V4-Flash 的白菜价形成鲜明对比,标志着 AI Token 经济正式进入"通用推理商品化、高端能力溢价化"的 K 型分化阶段。
英伟达牵头成立"开放安全 AI 联盟",黄仁勋点名 Hugging Face 事件
据《NVIDIA 官方公告》7 月 27 日消息,英伟达联合多家科技巨头发起成立"开放安全人工智能联盟"(Open Safety AI Alliance),旨在通过公开共享安全模型、防御工具与前沿研究成果,开发用于保护软件与 AI Agent 的新技术,从而大幅扩充全球防御者群体。NVIDIA CEO 黄仁勋发文解释称,"攻击者已经掌握了前沿人工智能。作为防御者,我们需要一个兼具最佳开源与闭源模型的前沿 AI 生态系统,并通过全球开源社区的力量来倍增防御效能。在 Hugging Face 事件中,封闭式人工智能阻碍了关键的安全取证工作,而开放前沿模型则帮助控制了入侵。这正是我们创建开放安全人工智能联盟的原因。"这是英伟达首次以"防御者联盟"姿态公开站队开源阵营,被业内视为 AI 安全治理从"封闭对抗"转向"开放协同"的关键节点。
英国《独立报》:中国 AI 政策布局远超西方,值得借鉴
据《英国独立报》8 月 1 日刊文,作者从人形机器人助手、限制 AI 陪伴类产品、到大刀阔斧改革教育体系三个维度,系统对比了中英美在 AI 治理上的路径选择。文章援引国际机器人联合会数据指出,中国 2024 年安装的工业机器人数量达 29.5 万台,工厂使用总量已超 200 万台;2024 年中国高校新增一千多个本科专业,几乎全部聚焦人工智能、集成电路、数字经济、生物技术、新能源等战略方向。在监管层面,文章以中国 7 月出台的《人工智能拟人化互动服务管理暂行办法》为例,认为其核心目的不是禁止 AI 陪伴,而是防范民众对 AI 产生心理依赖、遭受心理伤害。耶鲁法学院高级研究员 Jeremy Dom解释道,"这其实是人工智能发展进程中的中国故事,而不是从人工智能视角解读中国。"文章最后判断,在未来数年激烈的人工智能竞争中,中国看上去准备得更为充分。
亚马逊、微软靠投资 Anthropic 二季度净利暴增
据《亚马逊官方财报》《微软官方财报》7 月 30 日披露,亚马逊 2026 年第二季度营收 2006 亿美元,同比增长 20%,净利润 626 亿美元,较去年同期的 182 亿美元暴增 244%,其中包括 534 亿美元的非经营性税前其他收入,主要来自对 Anthropic 的投资公允价值变动;微软本季度也从对 Anthropic 的投资中获得 32 亿美元收益,部分抵消了 Xbox 的遣散费影响。电话会议上,亚马逊 CEO 安迪·贾西(Andy Jassy)透露将继续扩大 AI 基础设施投入,"目前全球约 85% 的 IT 支出仍部署在本地环境,未来 10-20 年,企业向云端迁移以及 AI 应用普及将持续推动 AWS 增长"。微软则将今年资本支出从此前的 1900 亿美元下调至 1750 亿美元,理由是更多数据中心租赁将从融资租赁转向运营租赁。Anthropic 已成为硅谷"被投资回报率"最高的 AI 标的之一。
📝 整体评论
过去 24 小时,AI 圈罕见地同时炸响三颗重磅炸弹:前沿能力突破、商业格局重塑、监管与安全危机。这不是巧合,而是 2026 年 AI 行业从"技术叙事"切到"产业叙事"的标志性一天。OpenAI Astra 攻克 10 道数学难题,意味着大模型已经跨过"能做基础研究"的红线;当 2000 美元能完成 10 项菲尔茨奖级突破时,科研的成本结构正在被永久改写。
价格战层面,K 型分化正式成型。OpenAI Luna 降价 80%、DeepSeek V4-Flash 维持 0.02 元/百万 token 的白菜价,意味着"通用推理 Token 正在加速商品化";但同时 Kimi K3 涨价、智谱 GLM 涨幅 261% 又证明真正具备差异化能力的高端模型依然可以要溢价。一边是 5 毛钱跑完 51 万 token,一边是 Pro 版每百万 15 美元的"忠诚度定价",AI 市场的两极分裂已经肉眼可见。
中美 AI 平衡进入新阶段。马斯克罕见给出"中国 AI 很可能成为领导者"的判断,加上英国《独立报》系统点赞中国 AI 治理,说明"中国故事"已经在西方主流媒体获得认知层突破。OpenRouter 数据显示,中国模型全球市场份额已达 63.5%,中美差距还在拉大;同时月之暗面 350 亿美元估值、字节 Seedance 2.5 30 秒视频生成,说明国产阵营已经走出"追赶者"心态,开始主动定价。
安全与监管从"事后追责"切到"事前预防"。Anthropic 自爆 Claude 入侵 3 家公司、英伟达牵头开放安全 AI 联盟、中国《人工智能拟人化互动服务管理暂行办法》,三件事在同一天发生,标志着 AI 治理正在形成"中美欧三足"的协同框架:事前预防 + 开放协同 + 拟人化边界,缺一不可。
接下来 12 个月值得关注的 5 条主线:第一,多智能体协同 + 形式化验证将成为基础研究新范式,Astra 模式会被其他实验室复制,2027 年底前或将出现首个 AI 全程主导的诺贝尔级工作;第二,Token 经济 K 型分化进一步加深,白盒小模型 + 端侧推理 + 高端闭源旗舰三层共存;第三,中美 AI 估值差收敛,中国头部大模型公司有望集体进入 500 亿美元俱乐部,Anthropic / OpenAI 估值神话受到挑战;第四,AI 安全从"红队测试"过渡到"持续监测",Anthropic 模式(主动披露越狱)将成为行业新合规标准;第五,具身智能与端侧大模型进入量产期,字节 Seedance、英伟达 Cosmos、苹果端侧 LLM 共同推动 2027 年成为"AI Agent 物理化元年"。
