1. 苹果为华训练专属 AI 大模型,阿里千问深度参与,Apple Intelligence 数月内入华

据《路透社》8 月 14 日援引三位知情人士的报道,苹果公司已专门针对中国市场训练出一款自有大语言模型,阿里集团提供算力与工程支持并参与训练。这将是苹果首次在海外市场部署专门定制的 AI 模型,而非简单移植海外版本。

知情人士透露,Apple Intelligence(苹果智能)预计将在未来数月内伴随 iOS 一次重大更新正式在中国推出,中国版 iPhone、iPad、Mac 与 Vision Pro 仍将以阿里 Qwen 作为外部能力扩展;阿里 Qwen 同步整合进写作工具与 Siri 增强。技术架构上,这款中国专属模型与苹果全球版 AFM 3 Core 系列保持一致路线:约 30 亿参数的小尺寸本地端侧模型 + 苹果私有云 Private Cloud Compute 调用服务器侧更强模型,在保证隐私与延迟可控的同时满足中国监管要求。中国国家互联网信息办公室已于 7 月 15 日完成对"Apple 智能"等 7 款端侧生成式 AI 服务的备案,这一僵持数年的合作正式扫清最后一道程序性障碍。


2. OpenAI 联合 Cerebras 推 GPT-5.6 Sol "Ultrafast" 模式,推理速度达 750 tokens/秒、提速 14 倍

据《Cerebras 投资者新闻稿》及《路透社》8 月 13 日美东时间报道,OpenAI 联合 AI 芯片公司 Cerebras 推出旗舰模型 GPT-5.6 Sol 的全新"Ultrafast(超高速)"服务层级,该模式下输出速度最高可达 750 tokens/秒,较标准模式约 53 tokens/秒的推理基线提速最高 14 倍,且不牺牲模型智能水平。

技术核心来自 Cerebras 的晶圆级引擎(Wafer-Scale Engine):每片晶圆级芯片集成 44GB 片上 SRAM,把整个模型的权重常驻在片上内存中,消除了 GPU 架构下权重在片上片外搬运的带宽瓶颈。横向对比(基于 Artificial Analysis 数据):Ultrafast 速度是 Claude Fable 5 的 11 倍,是 Claude Opus 4.8 Fast 模式的 5 倍。在衡量博士级难题的 HLE(Humanity's Last Exam,2500 题)实测中,Ultrafast 跑完全部题目用时 11 小时 11 分,Claude Fable 5 用时 78 小时 27 分,准确率相当,速度差距约 7 倍;在 GDP-Val 经济价值工作基准上则实现 5.6 倍端到端加速。当前 Ultrafast 处于有限预览阶段,仅向精选客户开放,规模化与定价策略未公开,但 OpenAI 内部研究员 Jeffrey Wang 已表示"任务在我还没机会切换上下文之前就完成了"。


3. OpenAI 年化营收破 400 亿美元、较 2025 年翻一番,正筹备 IPO

据《彭博社》8 月 13 日援引 OpenAI 内部公告的报道,OpenAI 2026 年年化营收预计将超过 400 亿美元(约 2700 亿元人民币),较 2025 年约 200 亿美元的水平直接翻一番。联合创始人兼总裁 Greg Brockman 在内部信中告知员工,仅 7 月份月度营收增长率就超过 20%,反映 Codex、ChatGPT Work 等 AI 智能体产品需求正在快速上升。

在竞争层面,Anthropic 于今年 5 月公布的年化营收为 470 亿美元,不过彭博指出两家公司在统计口径上存在差异,不能直接对比。为抵御外部竞争,OpenAI 已下调部分模型价格、聘请资深网络安全高管以提振企业销售。资本市场层面,OpenAI 已秘密递交 IPO 文件,Anthropic 也在为可能创纪录规模的 IPO 与潜在投资者举行初步沟通会议,会谈目前仍停留在宏观层面,尚未涉及具体估值。两家头部公司同期冲刺 IPO,意味着 2026 年底-2027 年初的全球 AI 资本市场将迎来"超级周期",也会重新校准整个行业的估值锚点。


4. Google DeepMind 完成 8 年来最大重组,Gemini 3.7 Flash 紧跟着 3 周后发布,新掌门人第一枪

据《路透社》《Google 官方博客》8 月 13 日发布的消息,Google DeepMind 完成 8 年来最剧烈的一次权力重组:联合创始人 Demis Hassabis 卸任 DeepMind CEO,转任 DeepMind 董事长与 Alphabet 首席科学家,集中精力 AGI 与前沿科学研究;CTO Koray Kavukcuoglu 升任高级副总裁,直接向 Sundar Pichai 汇报,统一管理 Gemini 模型开发、前沿研究、Gemini App 与开发者团队。

重组仅 8 天后,Google 推出 Gemini 3.7 Flash,定位为"迄今最智能的主力模型",重点面向编程与 Agent 任务。官方数据显示:FrontierCode 1.1 Main 得分 43.6%,超 Claude Sonnet 5(42.7%)与 GPT-5.6 Terra(41.3%);DeepSWE v1.1 得分从 3.6 Flash 的约 49% 跃升到 65.3%;Web Dev Arena Elo 从 1538 提升到 1588;AutomationBench 从 17.0% 提升到 30.4%,远超 Claude Sonnet 5 的 10.7%。同时,Google 宣布 3.7 Flash 限时半价促销至 2026 年底(输入 0.75 美元/百万 Token,输出 3.75 美元/百万 Token),从 2027 年 1 月 1 日起恢复原价。发布当天,新模型即进入个人 AI Agent Spark,服务 Google AI Pro 与 Ultra 订阅用户。三周迭代一次,这是 Koray 时代的明确提速信号,也意味着 Gemini 旗舰与 Flash 系列之间的性能差距正在被刻意压缩。


5. 阿里首次开源 Qwen-Max 级别旗舰权重,Qwen3.8-2.4T-A95B 登上 Hugging Face

据《Hugging Face 官方模型页》及《证券时报》8 月 13 日报道,阿里 Qwen 团队通过魔搭 ModelScope 社区正式开放 Qwen3.8-2.4T-A95B 模型权重——这是 Qwen-Max 级别旗舰模型首次对外开源权重。该模型总参数 2.4 万亿,采用 MoE 稀疏架构,每个 Token 激活 950 亿参数,原生支持 262,144 token 上下文,可扩展至 1,010,000 token。

架构细节:每层 512 个专家,每 Token 路由激活 10 个路由专家 + 1 个共享专家;隐藏维度 8192,层数 92,进行了多步 MTP 训练。官方云端版 Qwen3.8-Max 基于此权重构建,并额外加入视觉输入、非思考模式与内置工具等生产环境能力。基准成绩(云端版):Terminal Bench 2.1 86.6,SWE-bench Pro 67.7,PaperBench 93.0,DeepSWE 1.1 56.6,IFBench 82.8,GPQA Diamond 92.6,在 PaperBench、IFBench 等基准取得所列模型中的较高成绩。需要注意的是,开源版是纯文本模型、强制开启思考模式、不支持多模态,与完整云端旗舰体验有差距;同时,模型页仅标注"qwen3.8-max"许可证,商用边界由开发者自行确认。过去数周 Kimi K3、智谱 GLM-5.2、腾讯 Hy3、DeepSeek V4 Pro 相继迭代,阿里把 Max 级旗舰权重开源,意味着国产开源阵营在"性能 + 开放"维度同时向闭源实验室施压。


6. DeepSeek V4 Pro 正式版上线,首款智能体产品 Harness 以 MIT 协议开源

据《DeepSeek 官方》及《都市快报》8 月 13 日报道,DeepSeek 同步发布两件大事:一是 V4 Pro 正式版模型上线 App、网页端与 API;二是首款智能体(Agent)产品 DeepSeek Harness 以 MIT 协议开源,同步开启开发者预览版公测。项目负责人崔添翼在微博确认开源与公测启动,公开表示"目前的版本还很不完善,请大家多提提意见"。

V4 Pro 拥有 100 万 tokens 超长上下文,DeepSWE 基准得分从预览版 12.8 跃升至 62.7,在自动化任务与网络安全攻防专项测试中超越 Claude Fable 5;价格约为 V4 Flash 的 3 倍(输入 3 元/百万 tokens,输出 6 元/百万 tokens)。Harness 采用"一切皆插件"架构,基于 Cordis 插件系统,模型、工具、沙箱均可自由组合,提供标准、PTC、极简、创造四种运行模式,内置"极简模式"应付日常问答、"代码模式"处理批量搜索与自动化任务,直接对标 Claude Code。内测用户在海外社交平台表示"内测 2 天之后,我愿称 DeepSeek Harness 为宇宙最强"。伴随 V4 全系列上线,DeepSeek 大幅上调 API 价格并引入峰谷定价机制,旗舰模型输出价格涨幅达 350%——摩根士丹利研报指出,中国大模型 API 正从价格战转向以模型能力为核心的智力竞争新阶段。


7. xAI 推出 Grok Bot 智能体平台,智能体可互发消息、共享任务、向上级汇报

据《xAI 官方》及《CNET》《Tom's Hardware》8 月 13 日报道,Elon Musk 旗下 xAI 正式推出 Grok Bot 智能体平台——由 xAI 与 AI 开发公司 Cursor 联合开发(背景:SpaceX 正以 600 亿美元收购 Cursor)。与 Grok 聊天机器人不同,Grok Bot 是一个由多个 AI 智能体组成的工作团队,智能体之间可以互发消息、群聊、共享任务成果,甚至可以向 AI"上司"汇报工作。

用户可创建一个或多个 AI 智能体,运行在云端独立计算环境而非本地设备,可授权智能体访问指定应用、网站与邮箱;只需向 Bot 发送一条消息,智能体就会从头到尾独立完成任务,只有在需要用户审批时才会主动联系。xAI 内部员工已率先使用 Grok Bot,应用于销售跟进、招聘筛选、发票处理与漏洞修复等场景。当前 Grok Bot 处于公测阶段,已向 SuperGrok Heavy、Cursor Ultra、Cursor Teams Premium 订阅用户开放桌面端与 iOS;企业用户可加入候补名单。Grok Bot 与 Grok Bot 团队成员可分工处理邮件、费用报销、招聘、漏洞修复与日常运营,用户还可创建"总监"智能体统筹其他智能体。同日,马斯克在 SpaceX 员工会议上透露,SpaceXAI 数据中心电力容量将在 2027 年底前扩至 10GW(较当前 1.4GW 增长约 7 倍),按每瓦 30-50 美元测算可带来 3000-5000 亿美元年收入。


8. Anthropic Claude 文本隐形水印引公平性、版权、隐私三重争议,8 月 2 日起全球默认启用

据《Anthropic 官方声明》及《IT 时代网》《路透社》8 月 13 日报道,Anthropic 宣布部分 Claude 模型会在输出文本里嵌入一种难以察觉的隐形水印。这段文字即便被复制粘贴,水印仍会跟着保留,经过一定程度修改也可能继续存在,用来帮助判断一段内容究竟由 AI 生成还是出自人类之手。8 月 2 日起,全球范围内受支持的 Claude 模型生成文本已默认带上水印,这是 Anthropic 签署欧盟《人工智能法案》第 50 条关于 AI 生成内容透明度行为准则的具体落地动作。

外界对水印的争议集中在三点。一是公平性:投资人 Bill Gurley 担心"如果只有 Anthropic 能识别自家水印,公司就可能同时扮演法官、陪审团和检察官",Anthropic 已回应将提供免费 API 让第三方自行检测;二是内容边界:医疗 AI 负责人 Simon Smith 提问"把一篇文章交给 Claude 做语法检查,这种轻微处理过的文字是否也会被认定为 AI 创作",Anthropic 表示水印仅代表"Claude 曾经处理过这段文本";三是版权与隐私:微软前高管 Steven Sinofsky 关注"数据保留与数字隐私",软件工程师培训师 John Crigger 指出"AI 生成代码若带水印,版权归属可能更难界定"。Anthropic 并不是唯一行动的公司,Google 用 SynthID 为 AI 生成内容加水印,OpenAI 也在部分图片与音频中采用 SynthID,马斯克旗下 X 平台会给 AI 生成内容打上"由 AI 制作"标签。监管驱动的水印落地,正在重塑"内容身份层"的全球技术标准。


9. Meta 发布 300 亿参数端侧模型 Muse Glimmer,LG 与 NVIDIA 签 MOU 把 AI 工厂、人形机器人、车载 AI 同步落地

据《Meta 官方》及《SiliconANGLE》《IT 之家》8 月 12-13 日报道,Meta 周一发布 300 亿参数 AI 模型 Muse Glimmer,经过 4 位量化压缩至约 20GB,使其能够在配备 24GB 显存的单块 GPU 的 PC 或 Mac 上运行,为企业提供本地运行持续性智能体工作流的能力,Apache 2.0 许可证开放。这是 Meta 把"智能体"从云端按 Token 计费模式,推回桌面端资本支出模式的关键尝试。

Meta 官方表示:"以全精度运行,300 亿参数模型需要超过 55GB 内存,远超任何消费级 GPU 上限;我们使用量化技术将模型权重压缩至约 4 位精度,使语言模型体积缩小至 20GB 以内,几乎不引入智能体任务的性能损失。"不过 Digital 520 首席顾问 Noah Kenin 指出,Meta 发布的更像"发动机"而非"完整车",要跨过"企业级投资回报"这道门槛仍需时日。同日,LG 与 NVIDIA 在圣克拉拉 NVIDIA 总部签署 MOU,双方 CEO 具光模与黄仁勋均出席。LG 计划 2027 Q1 公开基于 Jetson Thor 芯片、Isaac GR00T 平台、Halos for Robotics 安全系统的新一代双足人形机器人;2027 H1 建设基于 Vera Rubin 芯片的 NVIDIA DSX 架构 AI 工厂示范项目;2028 H1 在韩国忠清南道天安市建成一座 80MW AI 工厂,同步开发集成 NVIDIA DRIVE Hyperion 的车载高性能计算平台。LG + NVIDIA + Meta 三件事同一天集中落地,意味着端侧智能体、人形机器人、AI 工厂、车载 AI 这四条"硬件+模型"主线正在被一次性按下加速键。


10. 2026 世界人形机器人运动会 8 月 22-26 日北京开赛,51 个项目 1301 场,具身智能"全民盛事"

据《央广网》《北京发布》8 月 14 日消息,2026 世界人形机器人运动会将于 8 月 22 日至 26 日在北京国家速滑馆"冰丝带"举行,正赛 5 天,共设 51 个项目、1301 场比赛。这是全球首个以人形机器人为竞赛主体的国际综合性科技体育盛会,赛事规模、竞赛项目与参赛队伍均较首届全面提质扩容。

六大单元看点包括:百米飞"人"极速冲刺挑战人类速度极限、武林巅峰争霸解锁机器人武术、综合五项全能、舞力对决花式舞蹈等。门票价格 98-670 元区间,通过"巢票赛演"微信小程序与大麦开放购票。门票向公众开放意味着具身智能从"实验室 + 工业展厅"正式进入"赛事化、消费化"阶段。赛事主办方表示,运动会将以"具身智能"为统一语境,推动核心零部件、运控算法、多模态感知与人类教练员协作等多条技术路线集中亮相。同周,8 月 14 日召开的 2026 年服贸会体育服务专题通气会也宣布,9 月 9-13 日在首钢园 5 号馆举办的人形机器人挑战赛将成为国内首个"赛事名城 + 科技 + 产业"联动的样板——城市之间科技、动网科技、咪咕体育等公司将以"展演 + 销售 + 投融资"复合形态落地。可以预见,8 月底-9 月初北京将连续承接两场具身智能"全民盛事",这是 2026 年中国具身智能产业从"出货量爆发"走向"认知普及"的关键节点。


📝 整体评论

过去 24 小时的全球 AI 头条,呈现出一种"两条主线 + 三个加速"的结构性信号:一条是 OpenAI 联手 Cerebras 把推理速度打成新护城河、苹果与阿里合作为中国训练专属大模型,中美 AI 合作正式破冰;另一条是中国大模型"开源 + Agent"双线齐发——阿里 Qwen3.8-2.4T 旗舰权重首次开源、DeepSeek V4 Pro + Harness 智能体平台 MIT 协议开源、月之暗面注册资本暴增 47% 冲刺 Pre-IPO。三个加速分别是:Google DeepMind 换帅后 8 天即发布 Gemini 3.7 Flash、xAI Grok Bot 把多智能体协作商业化、Anthropic 隐形水印落地引发"内容身份层"全球标准之争。

最值得划重点的,是OpenAI + Cerebras 的 14 倍速。这不再是一家模型公司换一家芯片公司的小修小补,而是把"晶圆级引擎 + 旗舰大模型"做成端到端垂直整合方案,直接挑战英伟达 Blackwell/Rubin 的"通用 GPU + 大模型"组合。14 倍速意味着当 OpenAI 客户在后台跑大批量 Agent 任务时,推理成本曲线会发生非线性下降——这是 Anthropic 把基础模型免费、OpenAI 用 Codex 与 ChatGPT Work 冲刺营收、Anthropic 同步冲刺 IPO 背后,真正决定 2027 年 AI 公司盈利能力的"隐形护城河"。配合英伟达与六大金融机构 5000 亿美元算力金融化、LG × NVIDIA 把 AI 工厂与人形机器人一次性打包落地,AI 基础设施正在从"卖芯片"向"卖算力服务"再向"卖速度体验"快速分层

苹果 + 阿里千问的中国 AI 大动作是今天最具地缘意义的信号。苹果选择在中国单独训练自有大模型,既保留 Apple Intelligence 的产品主权(自有 30 亿参数 AFM 3 Core + 私有云),又借助阿里 Qwen 解决中国 LLM 生态与工程部署问题,既绕开 Claude/ChatGPT 在中国无法直接复制全球方案的结构性障碍,又满足中国数据合规要求。中美 AI 生态不再是"脱钩"而是"双轨运行"——海外公司用"中国本地巨头"做合规、用户、算力通道,中国本地巨头用"海外旗舰生态"做技术背书与品牌势能。这与本月 Qwen3.8-2.4T 旗舰权重首次开源、DeepSeek V4 Pro 性能比肩 Claude Fable 5、月之暗面冲刺 Pre-IPO 估值 500 亿美元,共同勾勒出"中国大模型在 2026 年下半年集中跨过性能阈值"的轮廓。

监管与治理则开始从"原则"走向"运营":Anthropic 隐形水印在公平性、版权、隐私三个维度同时被质疑,意味着任何"AI 内容标识"方案都必须解决"谁有权检测""检测结果的法律效力""对人类轻度编辑后内容如何认定"三道难题;Google DeepMind 换帅、xAI 智能体商业化、Meta 端侧模型,共同把"AI 治理"从"原则宣言"推向"团队架构、产品价格、版权合同"的运营层。OpenAI 与 Anthropic 同期冲刺 IPO,意味着 2026 年底-2027 年初的全球 AI 资本市场将进入"超级周期",也会重新校准整个行业的估值锚点。

最后,接下来 12 个月值得关注的 4 条主线是:① 芯片-模型垂直整合 vs 算力金融化——Cerebras + OpenAI 的 14 倍速将与英伟达 5000 亿美元产融平台、AMD MI400、华为昇腾、寒武纪思元形成"四大算力阵营"分化;② 中美 AI 双轨生态落地——苹果 + 阿里是起点,Google、Meta、xAI 是否跟进"中国专属模型",将决定未来 12 个月中国大模型在企业级市场的渗透速度;③ Agent 商业化与"内容身份层"——xAI Grok Bot、DeepSeek Harness、Anthropic 隐形水印、Meta 端侧模型四件事同周发生,Agent 与水印会成为 2026 下半年最值得跟踪的"治理-商业"双螺旋;④ 具身智能的赛事化与消费化——北京世界人形机器人运动会(8/22-26)与服贸会人形机器人挑战赛(9/9-13)是产业从"出货量爆发"走向"认知普及"的关键节点,智元、宇树、特斯拉 Optimus、Figure、LG CLOiD 将在两个月内集中亮相。

ai-daily-cover

发表评论