Anthropic 现在会把 Claude 产生的 thinking block 和它当时对应的system prompt、tools、历史 messages绑定起来。后续请求如果你修改了这些上下文,再把原 thinking block 塞回去,API 会校验不一致,并把这段 thinking 丢掉,不再让模型看到。Anthropic 明确说,这么做就是为了防止通过“修改上下文 → 诱导 Claude 解密/复述 thinking → 批量收集 CoT”来做非法蒸馏。可以简单理解成:以前:Prompt A → Claude Thinking → 修改 Prompt A → 套出 Thinking → 批量训练学生模型现在:Prompt A + Tools A + History A ↔ Thinking A只要后续变成Prompt B / Tools B / History B,Thinking A 就失效。