AI 日报|前沿模型准入收紧,Agent 与算力竞赛升温

2777 字
14 分钟
AI 日报|前沿模型准入收紧,Agent 与算力竞赛升温

今天的 AI 行业同时沿着三条主线快速推进:前沿模型正在被纳入更严格的政府准入流程,算力与专用芯片成为模型竞争的硬约束,而 Agent 则从编码工具继续渗透到研究、法务、客服和团队协作。

GPT-5.6 的受限预览、Anthropic 模型出口管制的反复,以及 Google 无法完全满足 Meta 的 Gemini 算力需求,都说明行业竞争已经不再只是模型跑分。谁能获得稳定的模型访问权、算力供应和组织级 Agent 工作流,正在成为新的分水岭。

今日速览#

  • GPT-5.6 进入受限预览: OpenAI 发布 Sol、Terra 和 Luna 三层级产品线,但应美国政府要求暂未全面开放。
  • Anthropic 管制出现松动: Mythos 5 已向 100 多家美国机构恢复开放,Fable 5 也接近获准恢复,但稳定规则仍未形成。
  • 亚洲加速寻找替代方案: 360 与 Sakana AI 推出面向漏洞发现、网络防御和 Agent 编排的新工具,以降低对受管制模型的依赖。
  • 算力仍是产业瓶颈: Google 因容量不足限制 Meta 使用 Gemini,云业务订单增长快于基础设施供给。
  • OpenAI 加码自研基础设施: 与 Broadcom 联合推出 Jalapeño 推理芯片,计划在 2026 年底进入吉瓦级数据中心。
  • Agent 深入组织内部: OpenAI 内部 97.9% 的活跃用户使用 Codex,xAI、Anthropic 和 DeepMind 也分别推进自主执行、团队协作与安全控制。

GPT-5.6 发布与政府准入#

OpenAI 于 6 月 26 日发布 GPT-5.6 系列预览,包括旗舰模型 Sol、均衡型 Terra 和低成本 Luna。Sol 新增 max 深度推理模式,以及通过多个子 Agent 协作处理复杂任务的 ultra 模式。OpenAI 称其在编码、生物学和网络安全基准上取得明显提升,其中 Terminal-Bench 2.1 达到新的最佳水平。

安全投入也随能力同步增加。Sol 采用模型级拒绝训练、实时滥用检测和账户级审查等多层防护,自动化红队测试消耗超过 70 万 A100 GPU 小时。三款模型的定价分别为:Sol 每百万输入/输出 Token 5 美元和 30 美元,Terra 为 2.5 美元和 15 美元,Luna 为 1 美元和 6 美元。OpenAI 还计划于 7 月通过 Cerebras 提供最高约 750 Token/秒的 Sol 推理服务。

不过,这次发布最受关注的仍是开放方式。应美国政府要求,GPT-5.6 初期仅向少数可信合作伙伴提供预览。相关行政令允许企业在发布“受覆盖前沿模型”前向政府提交最长 30 天的审查。Sam Altman 表示广泛安全测试并非坏事,但不认同由政府挑选客户;OpenAI 也强调,这种介入不应成为长期常态。

TechCrunch 的政策分析进一步指出,名义上的“自愿审查”正在演变为事实上的许可制度。文章还对比了 OpenAI 与 Anthropic 的安全策略:Sol 更强调把护栏直接纳入核心模型行为,以减少独立分类器带来的误判和用户反弹。

相关来源:OpenAI 发布说明Reuters 报道TechCrunch 政策分析

Anthropic 管制松动与亚洲替代方案#

美国政府正在接近允许 Anthropic 恢复 Fable 5。此前,Mythos 5 和 Fable 5 因国家安全理由被紧急下线;6 月 26 日,商务部已率先允许 Mythos 5 向可信美国机构恢复开放。Fable 5 与 Mythos 基于同一底层模型,但面向更广泛的公众使用,因此审批节奏更慢。知情人士预计,相关限制最快可能在下周解除。

Mythos 5 的恢复范围已经覆盖 100 多家美国政府机构和企业,并首次允许这些机构及 Anthropic 内部的非美国籍员工访问。美国商务部称适当保障措施已经到位;Anthropic 则表示仍在继续协商,希望扩大模型开放范围。

出口限制也在推动亚洲市场建立本地替代能力。中国 360 推出用于自动发现软件漏洞的“屠龙风”和自动化网络防御工具“倚天镇”;日本 Sakana AI 推出面向 Agent 编排的 Fugu,目标客户是希望降低出口管制与供应中断风险的企业和政府机构。即便美国模型随后恢复供应,本地模型在供应链安全和可控性上的吸引力也已经被放大。

相关来源:Reuters:Fable 5 接近恢复TechCrunch:Mythos 5 向 100 多家机构开放TechCrunch:亚洲替代方案

算力短缺与自研芯片#

Google 限制 Meta 使用 Gemini#

据报道,Google 已限制 Meta 使用 Gemini 模型,原因并非商业竞争,而是 Meta 的算力需求超出 Google 当前可提供的容量。Google 在 3 月前后告知 Meta 无法满足其全部采购需求,导致 Meta 内部部分 AI 项目被迫中断或推迟,其他 Google Cloud 客户也受到较轻影响。

Meta 随后要求员工提高 AI Token 使用效率。Google Cloud 第一季度营收达到 200 亿美元,但 CEO Sundar Pichai 坦言算力瓶颈限制了进一步增长,云业务积压订单几乎翻倍。这件事再次说明,即使科技巨头持续投入芯片和数据中心,基础设施建设速度仍可能追不上模型调用需求。

阅读 Reuters 原文

OpenAI 与 Broadcom 推出 Jalapeño#

OpenAI 与 Broadcom 联合发布首款自研 AI 推理加速芯片 Jalapeño。OpenAI 负责架构定义,Broadcom 负责硅实现与 Tomahawk 网络互联,Celestica 负责系统集成。工程样片已经以目标频率和功耗运行 GPT-5.3-Codex-Spark 等负载,OpenAI 称其每瓦性能明显优于当前领先方案。

Jalapeño 从设计到流片仅用 9 个月,部分设计优化由 OpenAI 自有模型协助完成。首批芯片计划于 2026 年底部署,并逐步进入吉瓦级数据中心。对 OpenAI 来说,这不仅是降低推理成本的工程项目,也是把芯片、模型和产品连接成完整基础设施飞轮的一步。

阅读 OpenAI 原文

Agent 从编码工具走向组织工作流#

Codex 已覆盖 OpenAI 绝大多数活跃员工#

OpenAI 首次公开内部 Codex Agent 使用数据:截至 2026 年 6 月,97.9% 的 28 日活跃用户使用 Codex,Codex 占公司每周输出 Token 的 99.8%。增长最快的并非传统开发者,个人业务用户增长 137 倍,企业业务用户增长 189 倍。

在抽样用户中,80.6% 曾提交预计需要人工工作 30 分钟以上的任务,70.2% 提交过超过 1 小时的任务,25.6% 提交过超过 8 小时的任务。研究、客服、工程和法务团队的使用量都显著增长,说明 Agent 正在打破“只有工程师才写代码或自动化流程”的岗位边界。

阅读 OpenAI 原文

Codex-Maxxing:让长任务可持续运行#

OpenAI 发布由 Jason Liu 撰写的 Codex 长任务实践指南。核心方法包括使用持久线程持续积累上下文、以 GitHub 建立记忆库、通过心跳式自动化定期唤醒任务、在运行中追加指令,以及跨设备完成审查与批准。重点不再是一次提示词写得多漂亮,而是如何让 Agent 拥有稳定的上下文、反馈和恢复机制。

阅读 OpenAI 原文

xAI 推出 /goal 自主任务模式#

xAI 在 Grok Build 中上线 /goal 模式。用户给出目标后,Agent 会自动规划、拆分任务并持续执行到验证完成;期间仍可通过 statuspauseresume 等命令监控或调整。它把编码助手的交互方式从反复问答进一步推向“下达目标后持续工作”。

阅读 xAI 原文

Claude Tag 进入 Slack 团队协作#

Anthropic 推出的 Claude Tag 将 AI 作为团队成员嵌入 Slack 频道,支持多人共享上下文、主动推送信息和异步执行长任务。Agent 可以拆解任务并调用工具逐步完成工作,组织还可以按频道设置 Token 消费上限。该功能目前处于 Beta 阶段,面向 Enterprise 和 Team 客户。

阅读 Anthropic 原文

DeepMind 提出 Agent 纵深防御框架#

Google DeepMind 发布 AI Control Roadmap,将高能力但可能未对齐的 Agent 视作“内部威胁”管理。框架覆盖威胁建模、D1—D4 等级检测,以及 R1—R3 等级的预防和响应机制。DeepMind 表示已分析百万级 Agent 任务并部署实时监控器,同时呼吁产业、政策和学术界共同建立 Agent 安全标准。

阅读 Google DeepMind 原文

人才流动与 Agent 测试融资#

Vision Pro 高管加入 OpenAI 硬件团队#

Apple 负责 Vision Pro 的副总裁 Paul Meade 被曝将加入 OpenAI 硬件团队。Meade 还参与领导 Apple 计划推出的 AI 智能眼镜项目。对 Apple 来说,这是从高价头显转向更轻量可穿戴设备阶段的一次关键人才流失;对 OpenAI 来说,其硬件量产经验可能加速与 Jony Ive 合作的 AI 硬件项目。

阅读 TechCrunch 原文

Patronus AI 融资 5000 万美元#

Patronus AI 完成由 Greenfield Partners 领投的 5000 万美元 B 轮融资,累计融资达到 7000 万美元。公司在软件工程和金融领域构建用于压力测试 Agent 的“数字世界”,让 Agent 在模拟环境中执行任务,并通过强化学习奖励正确行为、惩罚失败。

随着 Agent 从问答系统走向多步自主执行,传统基准高分越来越难证明真实环境中的可靠性。Patronus AI 表示,几乎所有前沿 AI 实验室都已成为其客户,过去一年收入增长 15 倍。

阅读 TechCrunch 原文

本期核心主题#

主题涉及消息关键变化
GPT-5.6 与政府监管3 条Sol、Terra、Luna 开启受限预览,政府审查逐渐接近事实许可制度
Anthropic 出口管制3 条Mythos 5 已部分恢复,Fable 5 接近解禁,亚洲替代方案加速出现
算力与芯片2 条Google 无法完全满足 Meta 的模型需求,OpenAI 推出自研推理芯片
Agent 工作流与安全5 条Codex 深入组织内部,长任务、自主执行、团队协作和纵深防御同步发展
人才与融资2 条OpenAI 继续吸收硬件人才,Agent 压力测试平台获得新融资

下载完整日报文稿#

下载《AI 日报深度阅读|2026-06-28》DOCX 原稿


本文根据所提供的深度摘要整理,未对原始报道进行独立核验。原始材料涉及的 OpenAI、Reuters、TechCrunch、Anthropic、xAI 与 Google DeepMind 页面均未提供可纳入本文的公开评论内容。

文章分享

如果这篇文章对你有帮助,欢迎分享给更多人!

AI 日报|前沿模型准入收紧,Agent 与算力竞赛升温
https://blog.duanjianan.com/posts/ai-daily/2026-06-28/
作者
DuanJianan
发布于
2026-06-28
许可协议
CC BY-NC-SA 4.0

评论区

Profile Image of the Author
DuanJianan
技术、学习、项目与生活
公告
欢迎来到 DuanJianan's Blog。
音乐
封面

音乐

暂未播放

0:000:00
暂无歌词
分类
标签
站点统计
文章
11
分类
4
标签
24
总字数
41,888
运行时长
0
最后活动
0 天前
站点信息
构建平台
Cloudflare Pages
博客版本
Firefly v6.13.3
文章许可
CC BY-NC-SA 4.0

文章目录