覆盖窗口:2026-08-31 ~ 2026-09-02。所有条目均来自当日检索到的公开来源,附链接与日期;无新内容的分区如实标注。
🔥 今日头条
1. Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1:同一模型、两套安全护栏,缓存读取降价 75%
9 月 1 日,Anthropic 同时发布 Claude Fable 5.1(通用可用)与 Claude Mythos 5.1(仅通过可信访问计划开放)。两者是同一个底层模型,区别只在安全护栏强度——Mythos 5.1 面向经过审核的网络安全与生命科学专业人士。除能力提升外,这次发布明确回应了客户在价格、数据留存、误报三方面的长期抱怨。
价格上,输入 $10 / 输出 $50 每百万 token 不变,但缓存读取(cache read)降价 75%,降到 $0.25/Mtok;官方称典型负载总成本比 Fable 5 低约 25%,高度 agentic(上下文重、工具重)的负载最多可低约 45%。这对长时程 Agent 是实打实的结构性降本,因为这类负载的账单大头就是缓存读取。
2. Enterprise Frontier Safeguards:把「零数据留存」和「跨会话滥用检测」同时做到
同日发布的 EFS(Enterprise Frontier Safeguards) 是对 Fable 5 时期引入 30 天数据留存政策的正面回应。做法是:监控所需的活动数据存进客户自己的云账户(S3 / Azure Blob / GCS),用客户自己的密钥和审计策略;Anthropic 只负责运行自动化检测,命中信号直接推给客户,无需 Anthropic 员工人工审阅。
Anthropic 称与 100+ 家客户共同设计,参与方包括 ARC(成员含高盛、摩根士丹利、花旗、美银、富国等 CISO)以及 Comcast、KPMG、Mastercard、Salesforce、Visa 等。EFS 将支持 Claude Code、Claude Enterprise、Claude Platform、Amazon Bedrock、Google Agent Platform、Microsoft Foundry,今秋分阶段推出;EFS 就绪前,符合条件的客户可在 Fable 5 / 5.1 上先享零数据留存。Anthropic 不为 EFS 收费,云存储费用由云厂商正常计费。
3. 前沿模型开始产出可验证的科研成果:蛋白结合体、金星地形图、GPU kernel 提速
Fable/Mythos 5.1 发布页给出了三组经过外部实验验证的科研结果,值得单独拎出来看:
- 分子设计:Mythos 5.1 在三个靶点上设计出的结合体,亲和力比 Adaptyv Bio 蛋白设计竞赛的最佳投稿高 10 倍;12 个靶点上命中率接近 50%(该领域常规命中率 10–15%)。
- 计算分析:Fable 5.1 基于 NASA 麦哲伦号 30 多年前的雷达图像训练神经网络,重建了金星三分之一表面的高分辨率高程图,分辨率从 10–20 km 提升到 2–3 km,高度精度提升最多 25%,已以 CC 协议在 Zenodo 发布。
- 计算生物学:Mythos 5.1 通过手写 GPU kernel + 中间结果缓存,把 7 个开源深度学习模型加速最高 2.5 倍(输出完全一致),全基因组分析的 GPU 成本估算降低 30–60%。
需要留意的限定:这些是 Anthropic 自己披露的结果,部分由外部机构做实验验证,但尚未经过完整同行评审。
📦 官方发布与新功能
- Claude Fable 5.1 全平台可用,API 模型名
claude-fable-5-1,同时上线 AWS / Google Cloud / Microsoft Azure。基准成绩:Terminal-Bench-Science 0.1 达 52.6%(Fable 5 为 24.7%、Opus 5 为 29.0%);Terminal-Bench 4.0 达 55.8%(Mythos 5.1 为 60.9%);HLE 无工具 60.9%;OSWorld 2.0 strict 41.7%。— Anthropic, 09-01 - Claude Code v2.1.257(09-01):加入 Fable 5.1 作为默认 Fable 模型(1M 上下文);新增
timeFormat/timeZone设置;auto 模式新增 Containment Escape 规则(云元数据凭证获取、出网规避、跨租户访问不再自动批准);新增CLAUDE_CODE_SUBAGENT_MODEL_FORCE;/effort支持按s仅改本会话;新增permissions.blockReadsOutsideWorkingDirectories。v2.1.258(09-01) 修掉了 macOS 12 启动崩溃(2.1.255 引入的回归)。— Claude Code changelog - 反蒸馏机制收紧:自 09-01 起新建的 API 账户,不能再手工编辑多轮对话中 Claude 的历史上下文同时保留其思考记录——这堵死了一条公开的蒸馏路径。存量账户暂不受影响,但未来模型发布时会全量生效。— Anthropic 说明
- EU AI Act 文本水印检测 API 进入私有预览:面向监管机构、执法、媒体、事实核查、研究者、教育机构、欧盟公民社会组织及有合规义务的企业开放。— Anthropic, 09-01
- 安全护栏精度提升:网络安全方向误报下降,Claude Code 用户平均每会话被拦截次数减少约 60%;Fable 5.1 现在允许用于发现软件漏洞(但不允许开发利用代码);渗透测试、exploit 生成、二进制漏洞扫描仍会被重定向到 Opus 系列。— Anthropic, 09-01
🤖 Agent 技术精选
- Effort 参数官方指南更新:五档
low / medium / high / xhigh / max,默认high,作用于全部输出 token(文本、工具调用、thinking),不需要开启 thinking 即可生效。低档位会让模型合并并减少工具调用。关键坑:effort 参与 prompt 渲染,在同一个依赖缓存的会话中途改 effort 会打掉缓存前缀。— Effort — Claude Platform Docs - Task Budgets(beta,
task-budgets-2026-03-13):给整个 agentic loop 一个 token 预算,模型能看到服务端注入的倒计时标记并据此收尾。三个要点:①是软提示不是硬上限,硬上限仍是max_tokens;②最小值 20,000 token,给太小会引发「拒绝式行为」——直接不接任务或草草收场;③响应里没有 remaining 字段,只有模型看得到倒计时。Claude Code / Cowork 不支持,仅 Messages API。— Task budgets — Claude Platform Docs - MCP 路线图更新(08-22):延续 2026-07-28 规范把 MCP 从「双向有状态协议」改造为「请求/响应无状态协议」的方向,以支持水平扩展与标准 HTTP 路由。— MCP Blog: The New MCP Roadmap;2026-07-28 规范
- OpenAI Assistants API 已于 08-26 正式下线,迁移路径为 Responses API + Conversations API;同期还宣布了可复用 prompt 对象、Evals 平台、Agent Builder 的弃用时间表。做多模型 Agent 的工程侧需要排查依赖。— OpenAI 开发者社区公告;OpenAI API Changelog
🎓 学术与课程
- Stanford CS329A《Self-Improving AI Agents》 课程材料持续在公开渠道流转,主题覆盖 constitutional AI、verifier、test-time compute scaling、search + LLM、RL 训练期扩展,以及工具使用 / 代码 / 记忆增强与多模态编排。先修为 CS224N 或 CS229S。对今天的精选主题(推理预算)是直接对口的理论背景。— cs329a.stanford.edu
- 自适应 test-time compute 分配 是当前一条明确的论文主线,核心思路有三类:难度感知路由(difficulty-aware routing)、verifier/reward 引导的轨迹剪枝与停止、以及潜空间收敛的早退(early-exit);共同前提是「算力投入与准确率增益之间是凹函数关系」,所以把算力挪到边际收益最高的地方才划算。代表工作如 Adaptive Test-Time Compute Allocation for Reasoning LLMs via Constrained Policy Optimization(arXiv:2604.14853)。— arXiv:2604.14853
- Agent 记忆与上下文压缩方向近期活跃的预印本包括 Memory for autonomous LLM agents(arXiv:2603.07670)、Active context compression(arXiv:2601.07190)、Dynamic system instructions and tool exposure for efficient agentic LLMs(arXiv:2602.17046)。⚠️ 这几条来自二手检索结果聚合,建议按 arXiv ID 自行核对原文再引用。
📈 行业动态
- Anthropic 数据留存政策转向被主流财经媒体报道为「客户施压后的调整」,EFS 是其落地形式。— CNBC, 09-01
- Anthropic 确认 9 月进行 IPO 路演,市场预期 10 月挂牌。⚠️ 属市场传闻/二手报道范畴,以官方披露为准。— Yahoo Finance
- Salesforce × Anthropic「Claudeforce」:Salesforce in Claude 已向部分试点客户开放,预计 9 月进入开放测试。— Salesforce 新闻稿, 08-26
- 融资:Ollama 完成 6500 万美元 B 轮(Theory Ventures 领投,总融资 8800 万);Together AI 完成 8 亿美元 C 轮,估值 83 亿(Aramco Ventures 领投,Nvidia 参投)。⚠️ 来自行业资讯聚合站,建议以各公司官宣为准。— Value Add Pulse
- 开源权重榜单:GLM-5.2 在 SWE-bench Pro、Terminal-Bench 2.1 等开源权重编码榜上领先;DeepSeek V4-Flash、Mistral Small 4 把接近前沿的质量压到 2 卡可跑。⚠️ 榜单数据来自第三方汇总页,建议以各官方 leaderboard 为准。— Thunder Compute 汇总
🎯 今日精选主题
主题:Effort 档位与任务预算——LLM 推理预算工程
选择理由:今天所有官方新闻其实指向同一件事——推理算力正在变成一个需要显式分配的一类资源。Fable 5.1 的发布图表全部是「成绩 vs 成本(对数轴)按 effort 档位」的形式;缓存读取降价 75% 改变了长会话的成本结构;Claude Code 新增 /effort 的按会话覆盖;API 侧 output_config.effort 五档 + beta 的 task_budget 构成了一套完整控制面;学术侧的自适应 test-time compute 分配正好给出理论依据。对每天在 Claude Code 里跑长任务、又关心 token 账单的人,这是当下投入产出比最高的一个知识点——effort 调深度、task_budget 调广度,两者正交,且都有明确的踩坑点(缓存失效、预算过小引发拒绝)。
备选主题(如需替换,回复主题名即可;不回复则按上面这个执行):
- Enterprise Frontier Safeguards 架构:客户自有云存储 + 供应商侧自动检测的分离式安全架构,以及它对 ZDR 与滥用检测这对矛盾的解法。
- 模型反蒸馏与思考轨迹保护:从「禁止编辑历史 thinking」这条 API 变更出发,看蒸馏攻击面与防御机制的演进。
🧑💻 Claude Code 小课
今日为独立文档,见同目录 Claude Code小课-2026-09-02.md(第 23 课:新功能速用 —— Fable 5.1 与 v2.1.257/258)。
本简报由每日自动任务生成。带 ⚠️ 的条目为二手来源或未经独立核实,引用前请回溯原始出处。
主页