事件

Anthropic 已为 Claude 的加密隐藏推理增加“上下文锁”机制。

核心要点

  • Claude 的 API 加密推理须与生成时的系统提示、工具及消息历史保持一致

  • 上下文一旦被修改,相关推理内容即告失效

  • 该机制旨在防范模型蒸馏攻击


背景

此前攻击者可能利用其他兼容模型尝试读取 Claude 的加密推理。本次更新在原有“模型绑定”基础上,将推理内容与具体对话上下文绑定,封堵通过修改上下文提取推理过程的路径。