覆盖范围:过去 24-48 小时 | 方向:官方发布 / Agent 技术 / 学术课程 / 行业动态
📌 今日头条
1. Anthropic 发布 Claude Science Beta——面向科研的多 Agent 工作台 Claude Science 是一个可定制的科研应用:用户与一个「协调 Agent」交互,它可调用 60+ 科研技能(基因组学、蛋白质组学、化学信息学等),支持用户自建「专家 Agent」,并由「审查 Agent」核对引用与计算结果。这是多 Agent 架构在严肃科研场景的标志性落地,值得关注其协调-专家-审查的三层设计。 来源:Anthropic Newsroom · MarkTechPost 报道 (07-04)
2. MCP 史上最大版本更新:2026-07-28 规范候选版发布 Model Context Protocol 公布了自发布以来最大的一次修订(7月28日定稿):协议层改为无状态核心(可跑在普通 HTTP 负载均衡后)、新增 MCP Apps(服务器可下发沙箱化交互 UI)、Tasks 扩展(长时任务句柄化:tasks/get / update / cancel)、授权对齐 OAuth/OIDC,并首次引入正式弃用策略。对所有做 Agent 工程的人是必读变更。 来源:MCP 官方博客 · Stacktree 变更解读
3. Claude Sonnet 5 上线:最「agentic」的 Sonnet 推理、工具使用、编码全面超越 Sonnet 4.6,接近 Opus 4.8 水平;1M token 上下文、128k 最大输出,介绍价 $2/$10 每 MTok(至 8 月 31 日)。同时 Anthropic 全面上调 API 速率限制,Sonnet/Haiku 与 Opus 各档位对齐。 来源:Anthropic Newsroom · Releasebot 更新汇总
🏢 官方发布与新功能
- OpenAI 预览 GPT-5.6 Sol:新一代模型,强化编码/科学/网络安全;新增 max reasoning effort 与 ultra mode(子 Agent 加速复杂任务);Sol/Terra/Luna 三个长期能力档位;7 月起在 Cerebras 上以最高 750 tokens/s 提供。OpenAI 官方
- Google 推进 Gemini「从助手到 Agent」:Daily Brief(个性化晨报)、Gemini Spark(24/7 后台个人 Agent,登陆 macOS,可操作本地文件与 Workspace 全家桶)、Gemini Live 更新。Google AI 六月更新 · Forbes 分析
- Claude Enterprise 管理增强:更细的用量分析、按模型的权限控制、支出告警。Releasebot
- X(推特)上线官方 MCP 服务器,方便 AI 工具接入其平台。TechCrunch (06-30)
🛠 Agent 技术精选
- MCP 2026-07-28 规范详解:无状态核心 + Mcp-Method 路由头 + tools/list 客户端缓存(ttlMs);MCP Apps 的 UI 模板预声明机制让宿主可以预取/缓存/安全审查;所有 UI 动作走同一条 JSON-RPC 审计链。官方博客 · 2026 路线图
- Anthropic Engineering:长时运行 Agent 的有效 harness——如何让 Agent 跨多个上下文窗口持续推进任务,是当前开放难题的工程化拆解。原文
- Anthropic Engineering:Managed Agents——「大脑与双手解耦」的托管 Agent 扩展架构。原文
- Claude Cookbook:context engineering 实操(memory / compaction / tool clearing)。Cookbook
🎓 学术与课程
- arXiv 本周热点(agent 方向):Agents-A1(35B MoE agentic 模型,经三阶段训练+多教师蒸馏达到超大模型级 agent 表现);Self-Compacting Language Model Agents(自压缩上下文);AI-Trader(首个全自动金融决策 live benchmark);CommCP(基于保形预测的多 Agent 通信)。HF Trending Papers · awesome-ai-agent-papers 汇总
- Stanford CS329A(Self-Improving AI Agents):自我改进 Agent 前沿课程,覆盖工具使用/代码/记忆增强。课程主页
- Stanford CS224G(Building and Scaling LLM Applications):项目制课程,四大支柱:迭代、评测、部署、可观测。课程主页
- Berkeley Agentic AI(CS294/194-196):LLM 基础、推理规划、agentic 框架与基础设施、代码/机器人/网页自动化/科学发现应用。课程主页
📈 行业动态
- OpenAI 发布 GeneBench-Pro:计算生物学 Agent 研究级 benchmark,任务更难更贴近真实。llm-stats
- 开源模型持续逼近闭源前沿:Llama/Mistral/Qwen/DeepSeek 在多个 benchmark 上追平或超越闭源模型,开源滞后窗口(6-18 个月)持续收窄;开源 AI 模型市场从 2025 年 $190.5 亿增长到 2026 年 $230.8 亿(CAGR 21.1%)。Stanford AI Index 2026 · IEEE Spectrum 解读
- OpenAI 公布自研推理芯片 Jalapeño。llm-stats
🎯 今日精选主题(深度文档)
已选:MCP 2026-07-28 规范更新——无状态核心、MCP Apps 与 Tasks 扩展
选择理由:这是 MCP 发布以来最大的一次协议修订,7 月 28 日就定稿,直接影响所有 Agent 工程实践(部署架构、UI 交互、长时任务、鉴权),现在学习正当其时,且与你的「Agent 技术与工程实践」方向高度契合。
备选主题(回复编号可切换): 1. Claude Science 的多 Agent 架构——协调 Agent + 专家 Agent + 审查 Agent 的设计模式 2. 长时运行 Agent 的 harness 设计——跨上下文窗口持续推进任务(Anthropic Engineering 系列)
生成时间:2026-07-05 | 数据来源均附于各条目,时效以来源页为准