Anthropic为Claude隐藏思考加入“上下文锁”,进一步防范模型蒸馏

LDNews消息,Anthropic 开始为 Claude 的加密隐藏思考加入“上下文锁”。Claude 5.1 通过 API 生成的加密思考,需要与生成时的系统提示、工具及历史消息保持一致,一旦上下文被修改,相关思考内容将失效。

据悉,该机制主要用于防范模型蒸馏攻击。此前攻击者可能利用其他兼容模型尝试读取 Claude 生成的加密思考,而此次更新进一步将思考内容与具体对话上下文绑定,在此前“模型绑定”的基础上堵住通过修改上下文提取推理过程的路径。 [原文链接]

上一篇:

下一篇:

发表回复

登录后才能评论

联系我们

在线咨询: QQ交谈

微信:CryptoMetac

邮件:liandufin@163.com

工作时间:周一至周五,9:30-18:30,节假日休息

微信