Claude 破防了,开始反蒸馏了。 Anthropic 这次直接给 Fable 5.1 的 API 加了条规矩:你想让它接着上一轮的推理继续干活,就不能随便改...
小林coding · 软件开发
小林coding 2026-09-06 14:27 广东 Claude 破防了,开始反蒸馏了。 Anthropic 这次直接给 Fable 5.1 的 API 加了条规矩:你想让它接着上一轮的推理继续干活,就不能随便改掉那段推理之前的聊天记录、系统提示和工具。 你把前面的内容改了,又带着旧的推理记录发回来?不好意思,直接报错。 等一下,防蒸馏,为什么要管聊天记录? 你可以把蒸馏理解成,让一个模型向另一个模型学习。比如给 Claude 出题,收集它的回答,再拿去训练自己的模型。如果连它怎么一步步得出结论都能拿到,就多了一份学习材料。 但这些推理记录,也不是想拿就能拿的。在这次改规则之前,Claude 就已经给受保护的推理记录加了密,你拿到数据,也不能直接读出里面的内容。 于是有人绕了一步,改掉推理记录前面的对话,再把整段内容发回去,诱导 Claude 自己把里面的推理解密、输出。 相当于你打不开文件,就去骗能打开文件的人,让他念给你听。 所以这次,Claude 在 API 上加了一道检查:你传回旧的推理记录时,前面的聊天记录、系统提示和工具,得跟产生这段推理时保持一致。 对不上,直接拒绝请求。这样想通过改写前面的对话,骗它输出旧推理,这个套路就玩不了。 可能有的同学就问了,那我 Agent 接了 Claude API,上下文自动压缩了,也是改变聊天记录,那岂不是我也有影响? 确实,如果摘要替换了旧消息,相关的推理记录却还留着,就可能撞上这条规则。 Anthropic 官方给了个「非严格模式」:可以继续请求,但会移除受影响的推理记录。任务能接着跑,只是那部分旧推理,模型看不到了。 这次 Anthropic 重拳出击反蒸馏,你们说以后「小模型暴打大模型」的故事,会不会变少呢? 跳转微信打开