Anthropic 为 Claude 的加密思考链新增「上下文锁」,要求 API 调用时必须原样返回生成时的系统提示、工具和聊天记录,否则报错或丢弃思考。此举旨在防范模型蒸馏攻击,此前攻击者可让 Opus 生成高质量推理后由 Haiku 等模型解密提取。Fable 5.1 在绑定模型基础上进一步绑定对话上下文,防止通过修改提示词套取思考过程。
其他报道 (2条)