AI 日报|前沿模型重开,语音 Agent 与推理基建升温

2488 字
12 分钟
AI 日报|前沿模型重开,语音 Agent 与推理基建升温

今天的 AI 行业围绕前沿模型重新开放、Agent 产品化和推理基础设施扩张同步推进。Anthropic 在恢复 Fable 5 全球访问的同时推出 Sonnet 5 与 Claude Science;OpenAI、Google、xAI 和 DeepSeek 则从旗舰模型、多模态生成、语音 Agent 到开源 Agent 能力继续扩展产品边界。

模型能力加速落地也带来新的治理和资本议题。美国解除 Anthropic 模型出口管制并推动越狱评估标准,联合国专家小组警告治理能力滞后;Together AI、Etched 与 AWS 的投入则显示推理服务、专用芯片和企业部署仍是资金密集的竞争焦点。

今日速览#

  • Anthropic 三线推进: Fable 5 恢复全球访问,Claude Sonnet 5 与 Claude Science 同步发布。
  • 旗舰模型继续升级: GPT-5.6 Sol 进入有限预览,DeepSeek-V4 以百万 Token 上下文和开源 Agent 能力亮相。
  • Agent 产品形态扩张: xAI 推出无代码 Voice Agent Builder,Google 将 Computer Use 原生集成 Gemini 3.5 Flash。
  • 多模态与芯片并进: Google 发布图像和视频模型,OpenAI 与 Broadcom 推进 Jalapeño 推理芯片。
  • 资本投入保持高位: Together AI 融资 8 亿美元,Etched 获得 10 亿美元订单,AWS 成立 10 亿美元 FDE 组织。
  • 治理压力上升: 美国调整前沿模型出口管制,联合国专家小组警告 AI 风险与治理碎片化。

前沿模型与安全治理#

Anthropic 恢复 Fable 5 全球访问#

Anthropic 宣布恢复 Fable 5 的全球访问。材料称,该模型因安全护栏可被绕过而受到美国政府出口管制;Anthropic 随后训练了新的安全分类器,可在超过 99% 的情况下拦截相关行为。Fable 5 现已恢复至 Claude 平台、Claude.ai、Claude Code 和 Claude Cowork,部分付费用户在 7 月 7 日前可获得最高 50% 的周用量配额。

Anthropic 同时与美国政府达成预发布评估、快速信息共享、联合研究和行业共同标准四项合作承诺,并与 Amazon、Microsoft、Google 等提出越狱严重性评分框架。

阅读 Anthropic 原文

Claude Sonnet 5 强化自主 Agent 能力#

Anthropic 发布 Claude Sonnet 5,并称其为自主 Agent 能力最强的 Sonnet 模型。材料显示,该模型在较高 effort 水平下可于 BrowseComp、OSWorld-Verified 等评测中匹敌 Opus 4.8;优惠期 API 价格为每百万 Token 输入 2 美元、输出 10 美元,8 月 31 日后恢复为 3 美元和 15 美元。新分词器可能使相同内容的 Token 数增加 1.0 至 1.35 倍。

Sonnet 5 默认面向 Free 和 Pro 用户,Max、Team、Enterprise 用户及 Claude Code 也可使用。材料还称,其在 Agent 场景中的拒答和抗提示注入能力优于 Sonnet 4.6,而网络安全能力明显低于 Opus 系列。

阅读 Anthropic 原文

GPT-5.6 Sol、Terra 与 Luna 开启有限预览#

OpenAI 开启 GPT-5.6 系列有限预览,包括旗舰 Sol、均衡 Terra 和轻量 Luna。材料称,Sol 在 TerminalBench 2.1 中取得 88.8%,Ultra 模式为 91.9%;系列引入 max 推理强度与 ultra 子智能体模式,并采用超过 70 万 A100 GPU 小时的自动化红队安全测试。

每百万 Token 输入与输出价格分别为 Sol 5/30 美元、Terra 2.5/15 美元、Luna 1/6 美元。预览期仅向可信伙伴开放,计划 7 月由 Cerebras 提供每秒 750 Token 的服务,并在未来数周扩大可用范围;材料称此次分阶段发布应美国政府要求进行。

阅读 OpenAI 原文

DeepSeek-V4 预览版扩展百万上下文#

DeepSeek 发布并开源 V4 预览版,提供 V4-Pro 与 V4-Flash 两个版本。材料称,V4 采用新注意力机制和 DSA 稀疏注意力,全系支持百万 Token 上下文;V4-Pro 的 Agent 能力达到开源模型领先水平,内部 Agentic Coding 评测优于 Sonnet 4.5,V4-Flash 则以接近的推理能力提供更经济的选择。

模型权重已上架 Hugging Face 与 ModelScope,官网、App 和 API 同步开放,并兼容 OpenAI 与 Anthropic 接口及思考模式。

阅读 DeepSeek 官方原文

美国解除 Fable 与 Mythos 出口管制#

路透社报道称,美国商务部于 6 月 30 日解除对 Anthropic 最新 Fable 和 Mythos 模型的出口管制,距离 6 月 12 日的限制令约三周。Fable 5 于 7 月 1 日面向公众开放,Mythos 5 将扩展至 Glasswing 项目的更多合作伙伴;商务部长 Howard Lutnick 仍保留重新实施许可要求的权力。

报道将此次调整与 Anthropic 对政府合作及行业越狱评估标准的承诺联系起来,也指出 OpenAI 的 GPT-5.6 曾因政府要求推迟全面发布。

阅读 Reuters 原文

联合国专家警告 AI 灾难性风险#

由 Yoshua Bengio 联合主持的联合国独立科学专家小组发布初步报告,警告 AI 发展速度已经超过科学理解和政府政策制定能力,当前无法保证其不会造成灾难性伤害。材料称,AI 可完成任务的复杂度每 4 至 7 个月翻倍,而全球治理仍然碎片化。

阅读 Reuters 原文

Agent 与专业工作台#

xAI 推出 Voice Agent Builder#

xAI 发布 Voice Agent Builder Beta,主打无需代码、两分钟内创建生产级语音 Agent。平台基于 Grok Voice 的端到端语音通路,整合电话通信、知识检索、工具调用与安全护栏,支持 80 多种内置语音和 25 种以上语言。

材料称,Grok Voice Think Fast 1.0 在 τ-voice Bench 中取得 67.3%,对比 Gemini 3.1 Flash Live 的 43.8% 和 GPT Realtime 1.5 的 35.3%。音频价格为每分钟 0.05 美元,电话通信另收每分钟 0.01 美元,无独立平台费。

阅读 xAI 原文

Gemini 3.5 Flash 原生集成 Computer Use#

Google 将 Computer Use 能力原生集成至 Gemini 3.5 Flash,使模型可直接在浏览器、移动端和桌面环境中执行 Agent 任务;此前该能力以独立模型形式提供。

阅读 Google 原文

Codex 推动工作转向长期委托#

OpenAI 经济研究论文指出,Codex 正推动工作方式从短期对话转向长期委托任务。材料显示,OpenAI 内部 Codex 输出 Token 占比从 2025 年 8 月不足 10% 上升至 2026 年 6 月的 99.8%,非开发者使用增速达到 137 倍,法律、招聘等非技术部门也将其作为主要 AI 工具。

阅读 OpenAI 原文

Claude Science 面向科研工作流#

Anthropic 发布 Claude Science,一款整合 PubMed、Jupyter、R 等研究工具的 AI 科学工作台,可支持 3D 蛋白质结构渲染和基因组浏览器等科学产物。产品采用多智能体架构并内置 60 多项预配置技能,现面向 Pro、Max、Team 和 Enterprise 用户公测,学术机构可享折扣。

阅读 Anthropic 原文

AWS 成立 10 亿美元 FDE 组织#

AWS 宣布成立规模 10 亿美元的前向部署工程师组织,将工程师派驻客户公司内部,为其构建和部署定制 AI Agent,并留下可持续维护的工程能力。材料将这一模式与 OpenAI、Anthropic 的类似举措相比较。

阅读 TechCrunch 原文

多模态与推理基础设施#

Google 发布 Nano Banana 2 Lite 与 Gemini Omni Flash#

Google DeepMind 发布 Nano Banana 2 Lite(gemini-3.1-flash-lite-image)与 Gemini Omni Flash(gemini-omni-flash-preview)。前者主打快速、低成本图像生成,文生图延迟约 4 秒,定价为每千分辨率图像 0.034 美元;后者结合多模态推理与视频生成编辑,支持对话式视频编辑,定价为每秒输出 0.10 美元,目前单段视频限 10 秒。

两款模型已上线 Google AI Studio、Gemini API 和 Enterprise Agent Platform。

阅读 Google 原文

OpenAI 与 Broadcom 发布 Jalapeño 推理芯片#

OpenAI 与 Broadcom 联合发布首款从零面向 LLM 推理设计的智能处理器 Jalapeño。材料称,工程样片已运行 GPT-5.3-Codex-Spark 等模型,设计到流片用时 9 个月;Broadcom 负责芯片实现与网络技术,Celestica 承担板卡和系统集成。

该芯片计划于 2026 年底开始部署,并联合微软等伙伴推进吉瓦级数据中心规模,以形成从芯片、模型到产品的全栈闭环。

阅读 OpenAI 原文

Etched 估值达 50 亿美元#

AI 推理芯片公司 Etched 估值达到 50 亿美元,累计订单突破 10 亿美元。材料称,其芯片由台积电制造,投资者包括 Geoffrey Hinton 与 Andrej Karpathy。

阅读 TechCrunch 原文

Together AI 融资 8 亿美元#

Together AI 完成 8 亿美元 C 轮融资,估值达到 83 亿美元,较 2025 年 2 月的 33 亿美元翻倍以上。本轮由 Aramco Ventures 领投,Vista Equity Partners、General Catalyst、Nvidia 和 Salesforce Ventures 等参投。

公司平台支持企业训练和运行 DeepSeek、MiniMax、Kimi 等开源模型,资金将用于扩展推理服务等产品线。材料称,其上季度年化订单额超过 11.5 亿美元,客户包括 Cursor、Cognition,未来五年算力预计扩容约 50 倍。

阅读 Reuters 原文

本期核心主题#

主题涉及消息关键变化
Anthropic 发布与治理4 条Fable 5 恢复、Sonnet 5 和 Claude Science 发布,美国解除相关出口管制
Agent 产品化4 条语音 Agent、Computer Use、长期任务委托与企业 FDE 部署同步推进
前沿与开源模型2 条GPT-5.6 有限预览,DeepSeek-V4 扩展百万上下文和 Agent 能力
推理与多模态基建3 条Google 扩展图像视频模型,Jalapeño 与 Etched 推动专用推理硬件
资本与治理2 条Together AI 大额融资,联合国专家警告风险与治理滞后

下载完整日报文稿#

下载《AI 日报深度阅读|2026-07-02》DOCX 原稿


本文根据所提供的深度摘要整理,未对原始报道进行独立核验。原始材料均未提供可纳入本文的公开评论内容。

文章分享

如果这篇文章对你有帮助,欢迎分享给更多人!

AI 日报|前沿模型重开,语音 Agent 与推理基建升温
https://blog.duanjianan.com/posts/ai-daily/2026-07-02/
作者
DuanJianan
发布于
2026-07-02
许可协议
CC BY-NC-SA 4.0

评论区

Profile Image of the Author
DuanJianan
技术、学习、项目与生活
公告
欢迎来到 DuanJianan's Blog。
音乐
封面

音乐

暂未播放

0:000:00
暂无歌词
分类
标签
站点统计
文章
11
分类
4
标签
24
总字数
41,888
运行时长
0
最后活动
0 天前
站点信息
构建平台
Cloudflare Pages
博客版本
Firefly v6.13.3
文章许可
CC BY-NC-SA 4.0

文章目录