覆盖窗口:2026-08-24 ~ 2026-08-26(过去 24–48 小时为主,含少量本周内重要背景) 原则:每条均来自公开搜索结果并标注来源;传闻/未经一手确认的内容明确标注。
一、今日头条
1. MCP 发布新版路线图:五大优先方向,「异步消息原语」排第一
MCP 核心维护者 David Soria Parra 与 Den Delimarsky 于 8 月 22 日发布了新一版路线图,把接下来的协议工作收敛为五个优先领域:智能体消息原语(agentic messaging primitives)、HTTP 原生传输统一与加固、Agent 身份与企业级安全、原语改进、SDK 开发者体验。
为什么重要:这是继 2026-07-28 规范(无状态核心、移除 initialize 握手、MRTR 多轮往返请求)之后的第一份方向文件,直接决定了未来半年哪些 SEP 会被优先评审——落在这五个方向里的提案「加速评审、通过概率最高」,方向之外的不会自动拒绝但排队靠后。对做 MCP server 的人来说,这份文件基本等于「路线依赖清单」。
来源:The New MCP Roadmap · 2026-08-22
2. 长任务不再靠阻塞:Tasks 扩展(SEP-2663)进入「转正」通道
路线图里明确写了要「让 Tasks 扩展成熟到可以进入规范正文」。Tasks 的核心是:服务端不再阻塞连接等结果,而是立刻返回一个持久句柄 taskId,客户端通过 tasks/get 轮询状态(working / input_required / completed / failed / cancelled),中途需要用户确认时任务转入 input_required,客户端用 tasks/update 回填。
为什么重要:这解决了 Agent 工程里最常见的一类坑——CI 流水线、批处理、人工审批这类几分钟到几小时的操作,过去只能靠长连接硬扛,一遇超时或客户端重启就全丢。有了持久句柄,断线可续、崩溃可恢复,而且服务端可以按请求决定是否转任务,客户端只需一次性声明能力。
来源:MCP Tasks 扩展文档 · SEP-2663 · ext-tasks 仓库
3. Claude Code v2.1.245(8/25)发布,修复 Linux 新版 glibc 启动崩溃
据第三方版本追踪站汇总,8 月 25 日发布的 v2.1.245 修复了一个影响最新 glibc 版本 Linux 用户的关键启动崩溃。本周(Week 34,8/17–8/21)的重头功能则是 /design 研究预览、内置 Concise 输出样式、claude remote-control 设备卡片,以及 ANTHROPIC_DEFAULT_MODEL 环境变量。
为什么重要:如果你在 Linux 上跑 Claude Code 且最近升级过系统库,这是必须升的版本。
来源:Claude Code 版本追踪(第三方) · Claude Code What's new
二、官方发布与新功能
- Claude Code Week 34 摘要:
/design研究预览把 Claude Design 的画板工作流搬进 CLI 与桌面端(需 v2.1.233+,Pro/Max/Team/Enterprise);新增内置 Concise 输出样式——直接给结果、跳过铺垫与叙述,但工作深度不变(注意:输出样式属于系统提示,会话启动时读取一次,改完需/clear或新开会话才生效)。来源 · Concise 说明 - OpenAI GPT-5.6 Sol Ultrafast 模式预览:据发布追踪汇总,Ultrafast 模式速度可达标准模式的约 14 倍;同时 GPT-5.6 Sol 的 API 与额度价格下调超过 20%(为期三个月),并在 ChatGPT Work / Codex credits 逐步开放。来源
- OpenAI o3 于 8 月 26 日(今日)从 ChatGPT 下线,走完 90 天日落期;官方 DALL·E GPT 将于 8 月 30 日退役。来源
- Google Gemini 3.6 Flash 与 3.5 Flash-Lite 转为 GA 稳定版:3.6 Flash 主打 token 效率与代码/智能体规划能力提升,价格低于 3.5 Flash;3.5 Flash-Lite 定位低延迟、高性价比的子智能体(subagent)选项,面向大批量自动化。来源
- Anthropic 内容水印:据报道,自 2026-08-02 起 Anthropic 发布的 Claude 产品会在 AI 生成内容中嵌入机器可读标记,以符合欧盟 AI 法案第 50(2) 条。来源
三、Agent 技术精选
- MCP 路线图五大方向拆解(详见头条):①异步消息原语——服务端主动事件(webhooks + channels,让客户端不必一直轮询)、跨 Agents / Transports / Triggers & Events 三个工作组做组合性评审、Tasks 转正;②HTTP 原生传输统一——让本地 server 也走 Streamable HTTP over stdio,一套传输覆盖本地与远程;③Agent 身份——推进 DPoP(RFC 9449)、Workload Identity Federation、ID-JAG 授权,替代「粘贴 API key + 长期 token」;④原语改进——
tools/call返回值统一契约 + 渐进式工具发现;⑤SDK 一致性与文档质量(因为越来越多人是「让 Agent 照着 SDK 文档写 MCP 代码」)。来源 - Tasks 扩展的通知机制:服务端可通过
notifications/tasks推送状态,客户端用subscriptions/listen订阅;每条通知携带完整任务状态,省掉一次tasks/get往返。轮询仍是默认,通知是可选优化。来源 - Google 开发者博客:面向生产的上下文感知多智能体框架架构——讨论如何在生产环境把上下文管理与多智能体编排做到既高效又可控。来源
- Claude Code Skills 文档的工程要点:技能体一旦加载会跨轮次驻留在上下文里,每一行都是重复 token 成本,因此官方明确建议「正文写做什么,别叙述为什么」;
description+when_to_use合并后在技能清单里截断于 1536 字符,所以关键用例必须写在最前面。来源
四、学术与课程
- Stanford CS329A《Self-Improving AI Agents》:3 学分研究生研讨课,先修 CS224N 或 CS229S,内容覆盖 constitutional AI、verifier、测试时计算扩展、工具/代码/记忆增强、多步推理与规划;成绩 50% 作业 + 50% 项目,项目形态可以是新评测集/基准、Agent 系统可靠性研究,或在既有基准上爬坡。课程页公开。课程主页 · Stanford Online
- arXiv 近期 Agent 方向论文(cs.CL / cs.MA):
- Adversarial Attacks in Multi-Agent LLM Pipelines: Unveiling Structural Vulnerabilities in Agentic AI Architectures(已被 IEEE GLOBECOM 2026 接收)——关注多智能体流水线的结构性脆弱点,而非单模型越狱。
- Discovering Efficient and Explainable Communication Topologies for LLM-based Multi-Agent Systems via Causal Inference——用因果推断挑多智能体通信拓扑。
- Molecular LLM Agents: From Architectural Design to Scientific Autonomy——LLM Agent 在分子/化学科研任务上的架构综述。
- arXiv cs.MA 最新列表 · cs.CL 最新列表
- 长时程检索中的上下文退化:Diagnosing and Mitigating Context Rot in Long-horizon Search,与本地 07-31 那份「上下文退化与自压缩」深度文档可对照阅读。arXiv 2606.29718
五、行业动态
- NVIDIA 在 Hot Chips 2026(8/24)公开 Vera CPU 内部架构:88 个自研 Olympus 核心分布在 6 个 chiplet 上,官方声称在智能体类负载上约 1.8 倍加速,特定交互场景下相对 Grace Blackwell 吞吐最高 30 倍。同时 Groq 3 LPX 推理加速卡进入满产,单机架最多可插 256 张接入 Vera Rubin 平台。⚠️ 数字来自厂商宣称,建议等第三方实测。来源
- 开源权重模型近期节奏:Qwen3.8 Max(阿里,8/2)、GLM-5.3(Z.AI,8/14)、GLM-5.2 Turbo(Z.AI,8/17)。来源
- ⚠️ 传闻/未一手确认:有报道称 OpenAI 内部 Astra 模型解决了 10 个此前未解的数学与理论计算机科学问题,算力成本约 2000 美元;另有报道称 Anthropic 正为 IPO 做准备、并在扩张自研芯片团队(8 月 22 日挖来一位 Google 芯片老将)。以上均未见 Anthropic / OpenAI 官方公告,先当作行业信号看,不要当事实引用。来源1 · 来源2
六、今日精选主题
🎯 已选:MCP Tasks 扩展与异步长任务(Asynchronous Tasks in MCP)
选择理由: 1. 时效性最强——8/22 路线图把「智能体消息原语」列为第一优先级,Tasks 从扩展转正是明确的近期目标,现在学正好赶在规范正文落地之前。 2. 工程痛点最真——只要你写过 MCP server,几乎一定被「长任务撑爆连接超时」坑过。Tasks 是官方给出的标准答案,而不是各家自己造的 job id 轮子。 3. 本地未覆盖——往期已有《MCP 无状态新规范》《MCP 新规范 2026-07-28》《工具规模化与渐进式发现》,但异步任务生命周期这条线还没单独讲过,正好补齐 MCP 系列的最后一块。
备选主题(如需改选,回复即可):
- 备选 A:MCP 服务端主动事件(Triggers & Events / Webhooks / Channels)——路线图里 Tasks 的姊妹方向,把「客户端拉」翻转成「服务端推」。目前还在工作组阶段,可参考资料少于 Tasks。
- 备选 B:MCP Server Card 与 .well-known 服务发现——让 MCP server 在「连上之前」就能被发现和推理。工作组进行中,规范尚未定稿。
七、今日无重要更新的分区
无。四个分区今日均有实质内容。
注:本简报不含 Claude Code 小课板块,小课为当日独立文档 Claude Code小课-2026-08-26.md。
主页