覆盖范围:过去 24-48 小时 | 所有条目均来自当日真实搜索结果,已标注来源
今日头条
1. MCP 企业托管授权(EMA)扩展转正 stable,Anthropic/Microsoft/Okta 已落地 MCP 官方将 Enterprise-Managed Authorization 扩展升级为 stable:组织通过自己的身份提供商(IdP)集中管控 MCP 服务器访问,用户登录一次即可访问所有已批准的服务器,取代逐服务器授权弹窗。Anthropic 已在 Claude/Claude Code/Cowork 共享 MCP 层实现,VS Code 已支持;服务器侧 Asana、Atlassian、Canva、Figma、Linear、Supabase 等已接入。这是 agent 进企业生产环境的关键一块拼图。 来源:InfoQ · WorkOS 解读
2. Google 明日(7月17日)发布 Gemini 3.5 Pro,推迟源于整体架构重构 第三方消息称 Google 放弃 Gemini 2.5 Pro 架构做整体重构,3.5 Pro 定档 7 月 17 日;同期已先行发布 Gemini 3.5 Flash,面向复杂 agentic 工作流与编码任务优化,输出速度号称快 4 倍。发布推迟叠加 DeepMind 人才流失传闻,一度影响 Alphabet 股价(细节待官方确认)。 来源:BigGo Finance · The Agent Report · llm-stats
3. Reflection 签下 $10 亿算力大单,叫板中国开源模型主导地位 AI 初创 Reflection 宣布向 Nebius 采购 $10 亿算力训练其开源模型,此前已与 SpaceX 达成每月 $1.5 亿(至 2029 年)的算力协议,计划今年内发布开源模型。美国阵营正在用重金对抗 DeepSeek/Qwen 等中国开源模型的生态优势。 来源:Forbes
官方发布与新功能
- ChatGPT 自定义指令上限从 1,500 字符扩至 5,000 字符(Pro/Plus/Enterprise/Business/Edu),并全量推送统一搜索(聊天、项目、图片、文档一处检索)。ChatGPT Release Notes · Releasebot
- Anthropic 推出 Claude「Reflect」仪表盘:可视化个人 AI 使用习惯(话题分布、使用模式),含月度回顾、专注设置、休息提醒与免打扰时段。TechCrunch · Releasebot
- Claude 新增自助式 HIPAA 配置(Enterprise 与 API 组织),BAA 审阅、指南下载、一键启用,面向医疗场景合规。Releasebot
- Google 面向印度 100 所学校试点 ATL Saathi(Gemini 驱动的教师助手,7月15日上线);Sheets 的 Fill with Gemini 与 AI 函数提高用量上限。Releasebot Gemini
- GPT-5.6 将成为 Microsoft 365 Copilot 首选模型(Word/Excel/PowerPoint/Chat/Cowork),OpenAI 与微软办公入口绑定继续加深。Releasebot
Agent 技术精选
- MCP 2026-07-28 正式版下周定稿:无状态核心(告别 sticky session)、MCP Apps 服务端 UI、Tasks 长任务扩展、OAuth/OIDC 对齐授权、正式弃用策略。RC 已可用,建议 MCP 服务器作者对照迁移。MCP 官方博客 · Stacktree 变更清单
- MCP Apps(SEP-1865)详解:服务器可预声明 HTML UI 模板,宿主在沙箱 iframe 渲染;UI 发起的每个动作都走与工具调用相同的 JSON-RPC 审计/授权路径。Google 同步发文讲 A2UI 与 MCP Apps 的声明式/自定义 UI 组合。MCP Blog · Google Developers Blog
- LangGraph Deep Agents 七月更新:新增删除文件系统工具、write_file 支持覆盖写、middleware 可覆盖默认实例;Q2 已上线 per-node 超时与 DeltaChannel 增量检查点。LangChain Changelog
- EMA 的安全争议:授权集中化改变了攻击面,SecurityWeek 等提醒企业评估 IdP 单点与 agent 权限聚合风险(与今日头条 1 对照阅读)。SecurityWeek
学术与课程
- arXiv:Self-Compacting Language Model Agents(2606.23525)——agent 自我压缩上下文,长任务上下文管理方向。arXiv
- arXiv:What LLM Agents Say When No One Is Watching——多智能体辩论中的社会结构与潜在目标涌现,cs.CL/cs.MA 交叉。arXiv cs.MA
- NVIDIA 发文总结 ICML 2026 开源模型研究趋势:开源权重模型正成为学术研究主力底座。NVIDIA Blog
- VoltAgent/awesome-ai-agent-papers 每周更新:2026 年对比 2025,agent harness、tool use、长上下文、扩散语言模型与推理服务基础设施方向论文明显增多。GitHub
- 课程方面今日无新讲座发布;Berkeley RDI 系列(Agentic AI f25 / Advanced LLM Agents)与 Stanford CS224G 材料持续可用。Berkeley RDI · CS224G
行业动态
- SWE-bench Pro 七月榜:Claude Mythos 5 以 80.3% 居首,Claude Fable 5 80% 第二,Sakana Fugu-Ultra 73.7% 第三(7月14日核验);SWE-bench Verified 上 Fable 5 以 95.0% 领先。BenchLM · llm-stats
- LMArena 七月文本榜:Claude Opus 4.8(1510+ Elo)、Gemini 3.1 Pro、GPT-5.5 Pro 三家破 1500,开源权重梯队逼近闭源前沿。LMArena 榜单汇总
- BMW i Ventures 设立 $3 亿新基金,投向 agentic AI、physical AI、工业软件与供应链(早期到 B 轮,北美与欧洲)。Forbes The Prompt
- 印度 AI 编码初创 Emergent 完成 $1.3 亿 C 轮,投后估值 $15 亿,累计融资 $2.3 亿。Crescendo AI News
- Future of Life Institute 发布 2026 AI Safety Index:Anthropic 获最高分 C+,OpenAI 与 Google DeepMind 均为 C;同期纽约时报等出版商就训练数据证据问题申请对 OpenAI 制裁。BuildFastWithAI 汇总
今日精选主题
✅ 已选:MCP 企业托管授权(EMA)与 Agent 身份认证
选择理由:EMA 本周升级 stable 是今日最硬核的工程新闻——它回答的是 agent 落地企业时绕不开的问题:agent 代表谁行动?权限从哪来?如何集中收放?这个主题串起 OAuth/OIDC、IdP 集成、动态客户端注册、跨服务器授权与新攻击面,与本文件夹已覆盖的「MCP 新规范」「Agent 沙箱与安全隔离」互补且不重复,官方规范 + Anthropic/Okta/WorkOS 实现文章资料充足,适合系统学习。
备选主题(回复编号可切换,不回复则按已选执行): 1. MCP Apps(SEP-1865)——给 agent 装上界面:沙箱 iframe 渲染、UI 动作走工具调用审计路径、与 Google A2UI 的组合 2. LangGraph Deep Agents——深层 agent 架构:文件系统工具、middleware 体系与增量检查点
生成时间:2026-07-16 | 数据来源:当日 WebSearch 实时检索,部分第三方汇总内容(Releasebot、BuildFastWithAI、llm-stats 等)可能存在误差,重要决策请以官方原文为准。