Claude Opus 4.1(claude-opus-4-1-20250805)模型已停用
使用 Claude Opus 4.1 的用户和应用将收到错误,必须迁移到 Claude Opus 5。研究人员可以通过外部研究人员访问计划申请继续使用。
第 4 期 · 2026年8月9日 · 8 月 3 日至 8 月 9 日当周
本期雷达监控了 32 个工具的 63 个来源,窗口内发布 33 条变化,选出 11 条,按重要性排序。比常规多一条,因为补入了卡在前两期窗口交界处漏掉的 Supabase 端点移除,它的截止日期在 9 月 23 日,不该再压一周。每条都带流水线抓到的前后对照证据,别只听我们说,展开看原文。
Anthropic 已退役 claude-opus-4-1-20250805,对它的所有请求现在直接返回错误,官方建议迁移到 Claude Opus 5。配置里还写着这个模型 ID 的服务不会静默降级,只会收到报错,需要尽快改。做研究需要继续访问的,可以申请 External Researcher Access Program。
使用 Claude Opus 4.1 的用户和应用将收到错误,必须迁移到 Claude Opus 5。研究人员可以通过外部研究人员访问计划申请继续使用。
Claude Code 修复了一个 Bash 权限绕过问题,构造过的命令可以把自身的一部分藏过权限检查。依赖权限模式来限制 agent 能执行哪些命令的团队值得马上升级,无人值守和共享环境里跑的实例尤其如此。
解决了精心构造的 Bash 命令可能绕过权限检查的安全漏洞
Supabase 管理 API 的 logs.all 端点将于 9 月 23 日移除,日志查询迁到新的 ClickHouse 后端端点,而且新端点只接受 ClickHouse SQL。直接调这个端点的脚本、集成和监控工具,都要在截止日期前完成查询改写和迁移。这条 7 月下旬就公告了,正好卡在前两期窗口的交界处被漏掉,趁离截止还有六周补上。
查询 logs.all 端点的用户必须在 2026 年 9 月 23 日之前迁移到新的 logs 端点,并将查询转换为 ClickHouse SQL 方言。这会影响直接调用此端点的脚本、集成和工具。
Kimi K3 在 GitHub Copilot 正式可用,由 GitHub 托管在 Fireworks AI 上,按量计费:每百万输入 token 3 美元、输出 15 美元、缓存输入 0.3 美元,和上期 Together AI 的报价一致。对 Business 和 Enterprise 计划默认关闭,管理员在 Copilot 设置里启用对应策略后,组织成员才能选到它。
用户将按使用量计费购买 Kimi K3 模型,输入、输出和缓存输入 token 的费率不同。由于 GitHub Actions 事故,定价文档发布暂时暂停。
groq.com/pricing 整页换成了 6.5 亿美元融资公告和公司定位文案,原来按模型列出的 token 价格表没有了。要比较成本现在得进控制台或文档里找数字;把 Groq 算在成本模型里的团队,建议自己留一份此前费率的存档。
访问定价页面的用户将无法找到模型、token 和工具的详细定价表。页面现在展示的是 Groq 6.5 亿美元融资和公司定位的营销信息。这大幅影响了试图比较成本或集成 Groq API 的开发者。
OpenAI 的 Fast mode 开始支持长上下文请求,GPT-5.6 Sol、Terra、Luna 上超过 272K token 的 prompt 也能走 Fast 档,官方称速度最高是 Standard 档的 2.5 倍。之前因为上下文太长只能回落到 Standard 的负载,可以重新测一遍。
使用 GPT-5.6 Sol、Terra 或 Luna 的开发者现在可以对超过 272K token 的长上下文提示使用 Fast 模式,获得显著更快的响应时间。
platform.openai.com · 另有 1 个来源报告了同一变化
Zep 新增「Zep for Emerging Companies」档位,面向融资额在 100 万到 1000 万美元之间的公司,首年 1.3 万美元,SOC 2 Type II、HIPAA BAA、DPA、保证速率上限和 AWS KMS BYOK 都包含在内。卡在标准档合规不够、企业档又谈不起之间的团队,多了一个中间选项。
Zep 推出针对融资 100 万至 1000 万美元的公司的新中端市场定价层,定位于标准层之间,提供企业功能但价格更低。
LangSmith 的 Managed Deep Agents 进入公开测试,深度 agent 可以托管在 LangSmith 上运行,不用自己维护执行环境。已经在 LangChain 生态里做长时任务 agent 的团队,可以拿托管版和自建部署比一比运维成本。
LangChain 用户现在可以通过 LangSmith 使用托管 Deep Agents,扩展了平台的代理编排功能。
blog.langchain.dev · 另有 1 个来源报告了同一变化
Replicate 上新了 Nvidia H200 GPU,单卡、双卡、四卡、八卡四种配置,单卡 144GB 显存,每秒 0.001525 美元(约每小时 5.49 美元)。注意 H200 容量要签承诺消费合同才能用,不是随开随用的按需档。
用户现在可以访问单个、双 GPU、四 GPU 和 8x 配置的 H200 GPU 实例。配备 144GB 内存的 H200 GPU 可用,支持高内存工作负载。容量需要承诺花费合同。
Gemini API 发布了两个具身推理模型端点的公开预览版,gemini-robotics-er-2-preview 和它的流式变体,覆盖空间推理、多机器人协同和低延迟交互。同一份 changelog 里还有一条容易漏看的截止日期,gemini-robotics-er-1.6-preview 将于 8 月 31 日关停,还在用 1.6 的项目这个月内就得迁走。
开发者现在可以构建具有具身推理功能、多机器人协调和低延迟交互流媒体支持的实时机器人 agent。
ai.google.dev · 另有 1 个来源报告了同一变化
langchain-anthropic 修复了调用方传入的 tool_choice 没有被完整保留的问题。在修复之前,靠 tool_choice 强制模型调用特定工具的代码未必真的生效;升级后行为回到调用方期望的样子,依赖这条路径的代码值得回归测一遍。
工具选择行为现在在调用者传递时被正确保留,确保了预期的工具调用模式。
本期到此为止。下一期可以直接送进邮箱,同时目录每日更新,每期周报永久可读。