#人工智能 A 社宣布 Claude Messages API 部署新机制防止规模化蒸馏,修改历史内容将导致思考块直接失效。现阶段新机制将应用于调用 Fable 5.1 的新 API 账户,后续新机制将覆盖所有 API 账户。如果开发者修改请求中的早期消息、系统提示或工具,请求会直接返回错误。查看全文:https://ourl.co/126629
据 A 社发布的最新支持文档,A 社开始调整 Claude Messages API 对思考块 (Thinking Block) 的处理方式,新机制将首先应用于 Claude Fable 5.1 的新 API 账户。新机制要求开发者在多轮对话中重新提交思考块时,产生该思考块的系统提示、工具定义和历史消息不能修改,否则 API 将拒绝请求。
此前开发者可以在后续请求中修改早期消息、系统提示和工具,同时继续携带原来的思考块,这种能力常用于上下文压缩、动态注入系统提醒等场景。新规则启用后 API 会验证思考块与原始上下文是否匹配,只要前面的系统提示、工具或消息被修改,请求会直接返回错误。
A 社同时提供非严格模式让开发者可以继续修改历史内容,但 API 会自动删除已经失效的思考块,再让 Claude API 继续响应。这样不会直接中断任务,但模型也无法继续利用此前保存的推理状态。
A 社解释称修改思考块之前的历史内容已经成为未经授权模型蒸馏的常见技术,Claude 的部分思考内容经过加密保护,但攻击者可以反复修改前置对话,让模型重新解释甚至输出相关推理,再利用大量虚假 API 账户收集数据训练其他模型。
A 社担心这种方法不仅能够转移模型能力,还可能绕过 Claude 原本针对网络攻击等高风险用途设置的安全措施,所以新机制可以降低通过反复修改提示词批量提取推理数据的可行性。
未来新机制会覆盖所有 API 账户,对重写历史消息、执行压缩或动态修改工具定义的智能体框架,开发者需要调整架构。A 社还称不修改历史内容也可以提高缓存命中率从而降低使用成本和响应延迟。






