数据截至 2026-08-13,覆盖过去 24-48 小时。所有条目均来自真实搜索结果并附来源链接。
今日头条
1. OpenAI 宣布 1100 亿美元新融资,投前估值 7300 亿美元 OpenAI 8 月 12 日公布新一轮融资:SoftBank 300 亿、NVIDIA 300 亿、Amazon 500 亿美元,并与 Amazon 签署多年战略合作,同时锁定 NVIDIA 下一代推理算力。这是 AI 史上最大单轮融资之一,标志着算力军备竞赛进入新量级,也让 Amazon 首次深度绑定 OpenAI。 来源:OpenAI: Scaling AI for everyone · OpenAI News 汇总(2026-08-12)
2. OpenAI 发布 GPT-5.6-Cyber:首个「进攻级」网络安全模型,仅限审批用户 8 月 10 日发布,基于 GPT-5.6-Sol 专项训练,可完成找零日漏洞、构建利用链等任务,高级网络安全请求完成率 95.0%(对比 GPT-5.6-Sol 仅 1.5%),刻意调低了双重用途任务的拒绝率。仅向 Accenture、IBM、PwC、CrowdStrike、Cloudflare 等审批企业开放;OpenAI 自评达到「High」风险阈值。这是大厂首次公开发布定位于进攻性安全工作的模型,行业分级管控成为焦点。 来源:Axios · VentureBeat · The Hacker News(2026-08-10)
3. Claude Code 明天(8 月 14 日)起对 Pro/Max/Team 默认开启 auto mode Anthropic 8 月 9 日宣布:auto mode 下 Claude Code 将自动执行操作,仅在动作被判定为「不可逆、破坏性或指向环境之外」时才询问。这是编码 Agent 从「事事确认」走向「默认自主」的标志性转折,权限与沙箱配置的重要性大幅上升(今日 Claude Code 小课即讲此题)。 来源:TechCrunch(2026-08-09)
官方发布与新功能
- Anthropic:Claude Cowork 扩展到移动端和 Web(Max 用户优先 beta);Claude for Government 进入 beta;Enterprise 新增管理分析、模型级配额与费用告警。来源:Anthropic 8 月动态汇总 · Releasebot
- Claude Code(近日版本 v2.1.226):新增 self-hosted environments(Team/Enterprise 可把自有机器/容器作为 web、移动、桌面会话的运行环境);支持从 HTTPS zip 安装插件(可选 SHA-256 校验);移除单会话 200 个 subagent 的上限。来源:What's new 官方文档 · Havoptic 版本梳理
- Meta:8 月 6 日发布 Muse Spark 1.2,8 月 10 日发布 Muse Glimmer(据第三方模型追踪站)。来源:模型发布追踪 · Evertune Tracker
- Google DeepMind:过去 48 小时无重大新发布;7 月下旬发布的 Gemini 3.6 Flash / 3.5 Flash-Lite / 3.5 Flash Cyber 仍是最新一批,3.5 Pro 持续延期。来源:TechCrunch
Agent 技术精选
- MCP 2026-07-28 规范正式发布(今日精选主题):无状态协议核心(废除 initialize 握手与 Mcp-Session-Id)、MRTR 多轮往返请求、Mcp-Method/Mcp-Name 头路由、列表结果可缓存、授权加固(RFC 9207 / CIMD 取代 DCR)、正式扩展框架(Tasks/MCP Apps/EMA);Tier 1 SDK 月下载近 5 亿。来源:MCP 官方博客(2026-07-28,近两周生态落地持续发酵)
- 《Diagnosing and Mitigating Context Rot in Long-horizon Search》:arXiv 新论文,系统分析长时程搜索任务中的「上下文腐烂」并给出缓解策略。来源:arXiv
- Sourcegraph《Context Engineering: A Practical Guide for AI Agents (2026)》:面向工程师的上下文工程实操指南,呼应「性能收益更多来自更好的上下文而非更好的模型」的行业共识。来源:Sourcegraph Blog
- O'Reilly《The AI Agents Stack (2026 Edition)》:2026 版 Agent 技术栈全景,梳理 harness、工具层、评测与部署模式。来源:O'Reilly Radar
学术与课程
- ContinualSkillBench(arXiv 2608.03874,8 月 4 日提交):提出动态评测框架,检验带外部技能库的 LLM Agent 能否真正「持续进化」能力,覆盖 5 个领域、每域 100 个按难度递进的关联子任务。来源:arXiv
- Stanford CS224G「Building & Scaling LLM Applications」:2026 冬季学期项目制课程,覆盖推理模型、Agent 工作流与负责任 AI。来源:课程主页
- Berkeley Agentic AI(CS294/194-196,Dawn Song):课程资料(含导论讲义)持续公开,建立在 LLM Agents MOOC 系列之上。来源:课程讲义
行业动态
- 8 月融资:Function Health $450M、Simile $200M+、CAIS $170M、Eliyan $145M,AI/医疗/基础设施仍是大额支票集中地。来源:8 月融资汇总
- MCP 生态规模:Tier 1 SDK 月下载近 5 亿次,TypeScript 与 Python SDK 双双突破累计 10 亿下载。来源:MCP 官方博客
- 截至 8 月 10 日的前沿模型时间线:最新前沿发布为 GPT-5.6-Cyber(OpenAI)与 Muse Glimmer(Meta)。来源:LLM Gateway Timeline · AI Release Tracker
今日精选主题
MCP 2026-07-28 规范:无状态化重构(Stateless Protocol Core)
选择理由:这是 MCP 自远程模式上线以来最重要的一次规范升级——从有状态双向协议改为请求/响应无状态协议,直接改变所有 MCP 服务器的部署与扩展方式(负载均衡、缓存、网关路由、授权)。生态方(AWS、Cloudflare、Microsoft、Figma、Supabase 等)已 day-zero 跟进,对你日常用的 Claude Code / Cowork 的 MCP 配置也有直接影响,且此前深度文档从未覆盖 MCP 规范本身。
备选主题(回复选择,不回复则按默认): 1. GPT-5.6-Cyber 与「进攻级」安全模型的分级管控(High/Critical 风险阈值、受控发布机制) 2. ContinualSkillBench:LLM Agent 的持续技能学习与进化评测
生成时间:2026-08-13 · 来源均为当日 WebSearch 实际检索结果
主页