AI 日报|前沿模型准入收紧,Agent 与算力竞赛升温
今天的 AI 行业同时沿着三条主线快速推进:前沿模型正在被纳入更严格的政府准入流程,算力与专用芯片成为模型竞争的硬约束,而 Agent 则从编码工具继续渗透到研究、法务、客服和团队协作。
GPT-5.6 的受限预览、Anthropic 模型出口管制的反复,以及 Google 无法完全满足 Meta 的 Gemini 算力需求,都说明行业竞争已经不再只是模型跑分。谁能获得稳定的模型访问权、算力供应和组织级 Agent 工作流,正在成为新的分水岭。
今日速览
- GPT-5.6 进入受限预览: OpenAI 发布 Sol、Terra 和 Luna 三层级产品线,但应美国政府要求暂未全面开放。
- Anthropic 管制出现松动: Mythos 5 已向 100 多家美国机构恢复开放,Fable 5 也接近获准恢复,但稳定规则仍未形成。
- 亚洲加速寻找替代方案: 360 与 Sakana AI 推出面向漏洞发现、网络防御和 Agent 编排的新工具,以降低对受管制模型的依赖。
- 算力仍是产业瓶颈: Google 因容量不足限制 Meta 使用 Gemini,云业务订单增长快于基础设施供给。
- OpenAI 加码自研基础设施: 与 Broadcom 联合推出 Jalapeño 推理芯片,计划在 2026 年底进入吉瓦级数据中心。
- Agent 深入组织内部: OpenAI 内部 97.9% 的活跃用户使用 Codex,xAI、Anthropic 和 DeepMind 也分别推进自主执行、团队协作与安全控制。
GPT-5.6 发布与政府准入
OpenAI 于 6 月 26 日发布 GPT-5.6 系列预览,包括旗舰模型 Sol、均衡型 Terra 和低成本 Luna。Sol 新增 max 深度推理模式,以及通过多个子 Agent 协作处理复杂任务的 ultra 模式。OpenAI 称其在编码、生物学和网络安全基准上取得明显提升,其中 Terminal-Bench 2.1 达到新的最佳水平。
安全投入也随能力同步增加。Sol 采用模型级拒绝训练、实时滥用检测和账户级审查等多层防护,自动化红队测试消耗超过 70 万 A100 GPU 小时。三款模型的定价分别为:Sol 每百万输入/输出 Token 5 美元和 30 美元,Terra 为 2.5 美元和 15 美元,Luna 为 1 美元和 6 美元。OpenAI 还计划于 7 月通过 Cerebras 提供最高约 750 Token/秒的 Sol 推理服务。
不过,这次发布最受关注的仍是开放方式。应美国政府要求,GPT-5.6 初期仅向少数可信合作伙伴提供预览。相关行政令允许企业在发布“受覆盖前沿模型”前向政府提交最长 30 天的审查。Sam Altman 表示广泛安全测试并非坏事,但不认同由政府挑选客户;OpenAI 也强调,这种介入不应成为长期常态。
TechCrunch 的政策分析进一步指出,名义上的“自愿审查”正在演变为事实上的许可制度。文章还对比了 OpenAI 与 Anthropic 的安全策略:Sol 更强调把护栏直接纳入核心模型行为,以减少独立分类器带来的误判和用户反弹。
Anthropic 管制松动与亚洲替代方案
美国政府正在接近允许 Anthropic 恢复 Fable 5。此前,Mythos 5 和 Fable 5 因国家安全理由被紧急下线;6 月 26 日,商务部已率先允许 Mythos 5 向可信美国机构恢复开放。Fable 5 与 Mythos 基于同一底层模型,但面向更广泛的公众使用,因此审批节奏更慢。知情人士预计,相关限制最快可能在下周解除。
Mythos 5 的恢复范围已经覆盖 100 多家美国政府机构和企业,并首次允许这些机构及 Anthropic 内部的非美国籍员工访问。美国商务部称适当保障措施已经到位;Anthropic 则表示仍在继续协商,希望扩大模型开放范围。
出口限制也在推动亚洲市场建立本地替代能力。中国 360 推出用于自动发现软件漏洞的“屠龙风”和自动化网络防御工具“倚天镇”;日本 Sakana AI 推出面向 Agent 编排的 Fugu,目标客户是希望降低出口管制与供应中断风险的企业和政府机构。即便美国模型随后恢复供应,本地模型在供应链安全和可控性上的吸引力也已经被放大。
相关来源:Reuters:Fable 5 接近恢复、TechCrunch:Mythos 5 向 100 多家机构开放、TechCrunch:亚洲替代方案
算力短缺与自研芯片
Google 限制 Meta 使用 Gemini
据报道,Google 已限制 Meta 使用 Gemini 模型,原因并非商业竞争,而是 Meta 的算力需求超出 Google 当前可提供的容量。Google 在 3 月前后告知 Meta 无法满足其全部采购需求,导致 Meta 内部部分 AI 项目被迫中断或推迟,其他 Google Cloud 客户也受到较轻影响。
Meta 随后要求员工提高 AI Token 使用效率。Google Cloud 第一季度营收达到 200 亿美元,但 CEO Sundar Pichai 坦言算力瓶颈限制了进一步增长,云业务积压订单几乎翻倍。这件事再次说明,即使科技巨头持续投入芯片和数据中心,基础设施建设速度仍可能追不上模型调用需求。
OpenAI 与 Broadcom 推出 Jalapeño
OpenAI 与 Broadcom 联合发布首款自研 AI 推理加速芯片 Jalapeño。OpenAI 负责架构定义,Broadcom 负责硅实现与 Tomahawk 网络互联,Celestica 负责系统集成。工程样片已经以目标频率和功耗运行 GPT-5.3-Codex-Spark 等负载,OpenAI 称其每瓦性能明显优于当前领先方案。
Jalapeño 从设计到流片仅用 9 个月,部分设计优化由 OpenAI 自有模型协助完成。首批芯片计划于 2026 年底部署,并逐步进入吉瓦级数据中心。对 OpenAI 来说,这不仅是降低推理成本的工程项目,也是把芯片、模型和产品连接成完整基础设施飞轮的一步。
Agent 从编码工具走向组织工作流
Codex 已覆盖 OpenAI 绝大多数活跃员工
OpenAI 首次公开内部 Codex Agent 使用数据:截至 2026 年 6 月,97.9% 的 28 日活跃用户使用 Codex,Codex 占公司每周输出 Token 的 99.8%。增长最快的并非传统开发者,个人业务用户增长 137 倍,企业业务用户增长 189 倍。
在抽样用户中,80.6% 曾提交预计需要人工工作 30 分钟以上的任务,70.2% 提交过超过 1 小时的任务,25.6% 提交过超过 8 小时的任务。研究、客服、工程和法务团队的使用量都显著增长,说明 Agent 正在打破“只有工程师才写代码或自动化流程”的岗位边界。
Codex-Maxxing:让长任务可持续运行
OpenAI 发布由 Jason Liu 撰写的 Codex 长任务实践指南。核心方法包括使用持久线程持续积累上下文、以 GitHub 建立记忆库、通过心跳式自动化定期唤醒任务、在运行中追加指令,以及跨设备完成审查与批准。重点不再是一次提示词写得多漂亮,而是如何让 Agent 拥有稳定的上下文、反馈和恢复机制。
xAI 推出 /goal 自主任务模式
xAI 在 Grok Build 中上线 /goal 模式。用户给出目标后,Agent 会自动规划、拆分任务并持续执行到验证完成;期间仍可通过 status、pause 和 resume 等命令监控或调整。它把编码助手的交互方式从反复问答进一步推向“下达目标后持续工作”。
Claude Tag 进入 Slack 团队协作
Anthropic 推出的 Claude Tag 将 AI 作为团队成员嵌入 Slack 频道,支持多人共享上下文、主动推送信息和异步执行长任务。Agent 可以拆解任务并调用工具逐步完成工作,组织还可以按频道设置 Token 消费上限。该功能目前处于 Beta 阶段,面向 Enterprise 和 Team 客户。
DeepMind 提出 Agent 纵深防御框架
Google DeepMind 发布 AI Control Roadmap,将高能力但可能未对齐的 Agent 视作“内部威胁”管理。框架覆盖威胁建模、D1—D4 等级检测,以及 R1—R3 等级的预防和响应机制。DeepMind 表示已分析百万级 Agent 任务并部署实时监控器,同时呼吁产业、政策和学术界共同建立 Agent 安全标准。
人才流动与 Agent 测试融资
Vision Pro 高管加入 OpenAI 硬件团队
Apple 负责 Vision Pro 的副总裁 Paul Meade 被曝将加入 OpenAI 硬件团队。Meade 还参与领导 Apple 计划推出的 AI 智能眼镜项目。对 Apple 来说,这是从高价头显转向更轻量可穿戴设备阶段的一次关键人才流失;对 OpenAI 来说,其硬件量产经验可能加速与 Jony Ive 合作的 AI 硬件项目。
Patronus AI 融资 5000 万美元
Patronus AI 完成由 Greenfield Partners 领投的 5000 万美元 B 轮融资,累计融资达到 7000 万美元。公司在软件工程和金融领域构建用于压力测试 Agent 的“数字世界”,让 Agent 在模拟环境中执行任务,并通过强化学习奖励正确行为、惩罚失败。
随着 Agent 从问答系统走向多步自主执行,传统基准高分越来越难证明真实环境中的可靠性。Patronus AI 表示,几乎所有前沿 AI 实验室都已成为其客户,过去一年收入增长 15 倍。
本期核心主题
| 主题 | 涉及消息 | 关键变化 |
|---|---|---|
| GPT-5.6 与政府监管 | 3 条 | Sol、Terra、Luna 开启受限预览,政府审查逐渐接近事实许可制度 |
| Anthropic 出口管制 | 3 条 | Mythos 5 已部分恢复,Fable 5 接近解禁,亚洲替代方案加速出现 |
| 算力与芯片 | 2 条 | Google 无法完全满足 Meta 的模型需求,OpenAI 推出自研推理芯片 |
| Agent 工作流与安全 | 5 条 | Codex 深入组织内部,长任务、自主执行、团队协作和纵深防御同步发展 |
| 人才与融资 | 2 条 | OpenAI 继续吸收硬件人才,Agent 压力测试平台获得新融资 |
下载完整日报文稿
下载《AI 日报深度阅读|2026-06-28》DOCX 原稿
本文根据所提供的深度摘要整理,未对原始报道进行独立核验。原始材料涉及的 OpenAI、Reuters、TechCrunch、Anthropic、xAI 与 Google DeepMind 页面均未提供可纳入本文的公开评论内容。
文章分享
如果这篇文章对你有帮助,欢迎分享给更多人!













