AI整理
Anthropic 调整 Claude API 思考块机制,防止模型推理被用于非法蒸馏
Anthropic 调整 Claude Fable 5.1 的 Messages API,要求多轮对话返回思考块时保持系统提示、工具和消息不变,否则报错;也可启用非严格模式删除不匹配思考块。新机制适用于 2026 年 8 月 31 日及以后创建的新 API 账户。
收起整理内容
整理重点
- Anthropic 调整 Claude Fable 5.1 的 Messages API,对于受影响账户,多轮对话返回此前的思考块时,必须同时保持生成该思考块时的系统提示、工具和消息不变,否则 API 将报错。
- 开发者可启用“非严格”模式,由系统删除不匹配的思考块后继续请求。
- Anthropic 称,修改早期上下文可被用于诱导模型解密并输出推理,是工业规模非法蒸馏的一种手段。
- 新机制目前适用于 2026 年 8 月 31 日及以后创建的 Fable 5.1 新 API 账户,未来模型版本将扩展至所有账户。
相关背景
不确定性说明