← 主页
2026年7月17日

AI 每日简报 · 2026-07-17

覆盖范围:过去 24-48 小时(7月15-16日)· 全部条目来自真实搜索结果,附来源链接


今日头条

1. Moonshot 发布 Kimi K3:史上最大开源模型,2.8T 参数 + 1M 上下文 月之暗面于 7 月 16 日发布 Kimi K3,2.8 万亿参数 MoE(激活 896 专家中的 16 个,约 A50B),原生视觉、100 万 token 上下文,号称首个开放的 3T 级模型。核心创新是 Kimi Delta Attention(KDA)混合线性注意力,百万上下文解码提速最高 6.3 倍;定价 $3/$15,以 Opus 4.8 级能力打 Sonnet 5 级价格,权重 7 月 27 日放出。这是开源阵营首次在旗舰级别正面对标 GPT-5.6 / Fable 5。 来源:MarkTechPost · VentureBeat · Latent Space AINews(2026-07-16)

2. Google DeepMind 启动生物韧性(Bioresilience)计划 7 月 16 日,DeepMind 联合 Isomorphic Labs 推出面向政府与研究者的生物威胁防御计划:病原体监测、疫苗与疗法加速设计、疫情响应,过去一年已建立 15+ 合作伙伴关系,并向可信研究机构扩大模型与 Agent 访问权限。这是"前沿模型既是生物风险源、也是防御工具"思路的落地。 来源:Yahoo Tech 独家(2026-07-16)

3. MCP 2026-07-28 新规范进入发布倒计时,RC 已可用 新版规范包含无状态协议核心、Extensions 框架、Tasks(长时任务)、MCP Apps(服务器渲染 UI)、授权强化与正式弃用政策,7 月 28 日定稿。无状态核心意味着远程 MCP 服务器可跑在普通轮询负载均衡后面,不再需要粘性会话。 来源:MCP 官方博客 · WorkOS 解读


官方发布与新功能

Agent 技术精选

学术与课程

行业动态


今日精选主题

✅ 已选:混合线性注意力 KDA——Kimi K3 如何把 1M 上下文解码提速 6.3 倍

理由:Kimi K3 是今日最大新闻,而它能以 2.8T 参数 + 1M 上下文落地的关键是 Kimi Delta Attention(Gated DeltaNet 的细粒度门控改进)+ Attention Residuals + Stable LatentMoE 这套架构组合。线性注意力/混合注意力是长上下文 Agent 的底层支撑技术,与你近期学的上下文工程、Agent 记忆一脉相承,且过去 12 天的深度文档均为 Agent 工程/MCP 方向,今天换架构视角正合适。

备选主题(回复编号可切换,默认按已选执行): 1. MCP Apps:服务器渲染交互 UI 的设计与安全模型(7-28 新规范核心扩展) 2. LangChain Deep Agents:深层任务分解 Agent 的架构与工程实践