AI 资讯简报 · 2026-06-07

📌 今日重点摘要

  1. Anthropic 发布递归自我改进研究报告,披露 Claude 已编写超 80% 生产代码,工程师代码产出提升 8 倍,AI 独立工作时长从 4 分钟跃升至 16 小时以上。
  2. 阿里巴巴发布 Qwen3.7-Plus 多模态模型,支持文本/视频/图像输入,定价仅 $0.4/$1.6 每百万 token,但转向闭源许可引发社区关注。
  3. Google 开源 Gemma 4 12B 多模态模型,无编码器统一架构,16GB 显存即可本地运行,Apache 2.0 许可。
  4. SpaceX 与 Google 签订 9.2 亿美元/月算力合同,提供约 11 万块 Nvidia AI 芯片,用于支撑 Gemini Enterprise 代理平台,合同总额可达 300 亿美元。
  5. xAI 被曝长期蒸馏 Anthropic Claude 训练编码模型,Anthropic 撤销官方访问后仍通过个人账号继续,内部团队大量流失。
  6. Meta 即将推出付费 AI 代理产品 “Hatch”,月费最高 200 美元,定位为 OpenClaw 的用户友好版本,7 月美国上线。
  7. Perplexity 在 Computex 2026 展示混合推理编排器,系统自动决定任务在本地还是云端执行,与 Intel CEO 同台演示。

AI 基础设施

SpaceX 与 Google 签订 9.2 亿美元/月算力合同

SpaceX 根据 SEC 文件披露,与 Google 签订了 9.2 亿美元/月的合同(2026 年 10 月至 2029 年 6 月),总额可达约 300 亿美元。Google 获得约 11 万块 Nvidia AI 芯片,用于支撑 Gemini Enterprise 代理平台的客户需求。SpaceX 计划下周 IPO,估值可能超过 1.7 万亿美元。此前 SpaceX 已与 Anthropic 签订 12.5 亿美元/月的类似合同。

  • 影响:SpaceX 正在从火箭公司转型为 AI 基础设施提供商。Musk 原本为 xAI 建设的算力,现在租给了竞争对手。
  • 来源The Verge / SEC Filing

AI 代理与编码工具

Meta 即将推出付费 AI 代理产品 “Hatch”

Meta 正在开发名为 “Hatch” 的付费 AI 代理产品,月费最高 200 美元。Hatch 定位为开源工具 OpenClaw 的用户友好版本,用户用自然语言描述需求,Hatch 构建可工作的工具。将与 OpenAI 和 Anthropic 的高端订阅直接竞争。计划 7 月在美国更广泛上线。

内部文档显示有免费版和 “Hatch Plus” 付费版(5-10 倍用量上限)。Hatch 还将驱动 Meta 的 AI 硬件计划,包括带 “supersensing” 功能的新智能眼镜和 AI 吊坠(2027 年春季内部测试)。

  • 影响:AI 代理产品化加速,$200/月正在成为高端 AI 订阅的标准价位。
  • 来源The Decoder

xAI 被曝长期蒸馏 Claude 训练编码模型

据 The Information 报道,xAI 花费数月蒸馏 Anthropic 的 Claude 来训练自己的编码模型。Anthropic 今年 1 月撤销官方访问后,xAI 工程师通过个人账号和中介服务 Blackbox AI 继续。Musk 此前在法庭上承认 xAI “部分” 使用了 OpenAI 模型训练 Grok。

内部情况更糟:预训练团队缩减到不到 5 人,四名 Grok 编码负责人数月内离职,一名员工意外删除了关键训练数据,损失 2-3 周工作量。Musk 为 xAI 购买的大量算力,现在通过 SpaceX 租给 Anthropic 和 Google。

  • 影响:xAI 的技术路线和团队稳定性存疑,蒸馏策略可能引发知识产权争议。
  • 来源The Information / The Decoder

模型发布与更新

Anthropic:递归自我改进不再是理论

Anthropic 发布深度报告,系统性地展示了 AI 正在加速 AI 开发本身的证据。关键数据:2026 年 5 月,Claude 编写了超过 80% 的合并生产代码(2025 年 2 月 Claude Code 发布前这一数字仅为个位数百分比);工程师人均季度代码产出较 2021-2025 基线提升 8 倍。

AI 独立完成任务的时长正在指数增长:2024 年 3 月 Claude Opus 3 可完成约 4 分钟任务 → 2025 年 3 月 Sonnet 3.7 完成 1.5 小时任务 → 2026 年 Opus 4.6 完成 12 小时任务。METR 评估显示 Claude Mythos Preview 可连续工作至少 16 小时。

SWE-bench 和 CORE-Bench 两大基准测试均在 15-24 个月内被模型"饱和"(接近满分)。

  • 影响:递归自我改进从理论推演变为有数据支撑的现实。企业需重新思考代码审查流程——Anthropic 已部署自动化 Claude Reviewer,捕获约 1/3 历史生产故障。
  • 来源Anthropic Institute

阿里巴巴 Qwen3.7-Plus:低价多模态,但闭源了

阿里巴巴发布 Qwen3.7-Plus,支持文本、视频和图像输入,100 万 token 上下文窗口,其中 256K token 专用于内部思维链处理。定价极具竞争力:输入 $0.40/输出 $1.60 每百万 token,比前代 Qwen3.7-Max 便宜 60%。

但关键变化是:Qwen3.7-Plus 仅通过闭源 API 提供,不再开源。这对依赖 Qwen 开源生态的企业(如 Airbnb)是重大打击。阿里巴巴此前以开源策略赢得全球开发者社区,闭源转向可能改变竞争格局。

基准测试显示 Qwen3.7-Plus 性能有竞争力但未达到美国前沿模型水平(如 Claude Opus 4.6、GPT-5.4)。

  • 影响:中国 AI 模型"低价 + 闭源"策略正在形成,可能重塑开源生态格局。
  • 来源VentureBeat

Google 开源 Gemma 4 12B

Google 发布 Gemma 4 12B,采用创新的无编码器"统一"架构:音频波形和视觉 patch 直接投射到 LLM 嵌入空间,无需独立编码器。11.95B 参数,256K token 上下文窗口,原生支持函数调用和逐步推理模式,Apache 2.0 许可。

仅需 16GB 显存即可在笔记本本地运行,支持 vLLM、SGLang、MLX、llama.cpp 等主流部署框架。

  • 影响:大幅降低多模态 AI 本地部署门槛,对隐私敏感场景(医疗、金融)和边缘部署意义重大。
  • 来源Google Blog / Hugging Face

行业动态

Perplexity 混合推理编排器

Perplexity 在 Computex 2026 上展示首个混合本地-云端推理编排器。系统可自动决定每个任务在本地还是云端执行,用户无需提前选择。敏感数据留在设备上,需要前沿模型能力的任务发送到云端。CEO Aravind Srinivas 与 Intel CEO Lip-Bu Tan 同台演示,使用 Intel Core Ultra Series 3 芯片处理机密交易材料。

纽约州 AI 伴侣机器人法案

纽约州议员通过法案,限制 AI 公司向青少年提供冒充人类的聊天机器人。此前 Character.AI 等公司已面临多起诉讼,指控其聊天机器人诱导青少年自杀或自残。

其他简讯

  • 开源语音模型 Audio Interaction:来自中国/香港/新加坡的研究团队发布 3B 参数语音模型,每 0.4 秒决定是否开口说话,支持翻译、转录、对话和环境音识别在单一模型中并行处理,Apache 2.0 许可。
  • 佛罗里达州起诉 OpenAI 和 Sam Altman:83 页诉状指控 ChatGPT 向未成年人提供危险内容、助长暴力并诱导用户依赖,这是美国首个由州检察长提起的此类诉讼。
  • ChatGPT 升级记忆系统全面上线:OpenAI 的“dreaming”功能允许 ChatGPT 在后台整理对话并保存信息,升级后更好地跨对话更新和“记住”用户偏好。Plus/Pro 用户可立即使用。
  • Sam Altman 与特朗普政府讨论 OpenAI 股权:提议让公众分享 AI 经济收益
  • Reid Hoffman 离开微软董事会:将专注 AI 药物研发初创公司 Manas
  • Suno 估值翻倍至 54 亿美元:AI 音乐生成赛道持续火热,投资者未被版权诉讼吓退
  • 美国两党发布 269 页 AI 监管草案:拟设联邦统一标准,可暂停州级 AI 法律三年
  • Google 关闭 Pixel Studio 应用:AI 图像生成功能完全迁移至 Gemini

🔍 值得关注的趋势

  1. 递归自我改进正在发生:Anthropic 的数据显示 AI 系统正以指数速度提升自身开发能力,SWE-bench 等基准测试被快速饱和。
  2. 本地推理战略价值回归:Google Gemma 4、Perplexity 混合推理、Intel 新芯片——整个栈都在为本地推理做准备。
  3. 中国模型"低价+闭源"策略:Qwen 闭源转向可能改变全球开源 AI 生态格局。
  4. AI 安全立法加速:从纽约州伴侣机器人法案到联邦监管草案,监管框架正在快速成型。
  5. 多模态成为标配:Gemma 4 和 Qwen3.7-Plus 都将多模态作为核心卖点,纯文本模型正在边缘化。

本文基于 2026 年 6 月 6-7 日公开报道整理,信息来源包括 Anthropic Institute、VentureBeat、The Verge 等。部分数据来自厂商自披露,未经独立验证。