Anthropic 为 Claude 加上下文锁,防止模型蒸馏
By: support.claude.com|2026/09/02 03:30:44
0
分享
Anthropic 为 Claude 的思考引入了「上下文锁」,要求通过 API 生成的加密思考必须与生成时的系统提示、工具和历史消息一同返回。若前面的内容被修改,API 将报错或丢弃该思考。这项改动旨在防止模型蒸馏,研究人员发现 Claude 的加密思考可以被其他模型读取,攻击者可利用高质量推理诱导较弱模型泄露完整思考过程。Anthropic 在 6 月发布 Fable 5 时已进行过一次防护,限制加密思考只能绑定于特定模型。Fable 5.1 进一步增加了「对话绑定」机制,任何修改前面的提示词、工具或聊天记录都将使旧思考作废。该锁目前尚未全面实施,8 月 31 日后新开的 API 账户将强制执行此规则,老账户暂时不受影响。Claude.ai、Claude Code、Cowork 等模型不在此范围内,Anthropic 表示未来新模型将默认启用该规则。
-- 价格
--
--
--
本内容仅供参考,不构成任何金融、投资、法律或税务建议。文中提及的任何活动、奖励、线上活动或相关信息,不应被视为对购买、出售或交易任何加密资产的推荐、招揽或邀请。加密资产具有高波动性,存在价值损失风险。WEEX服务、产品及相关活动的可用性可能因地区而异。用户在参与前有责任确保符合当地适用法律法规。
猜你喜欢

智谱AI入驻天猫开设旗舰店,提供多款大模型套餐

Meta发布Muse Spark 1.3模型,提升个人AI代理性能

人工智能:Anthropic 和 Nvidia 进军比特币挖矿巨头的领地

Empirik 完成2100万美元种子轮融资,利用AI预测系统故障

工具调用结果的总结
5 个 Academy 链接全部返回空字符串,日语版不存在,因此链接仅保留加粗文本。

Optimism瞄准200毫秒子块,数据馈送丢失关键信息
Optimism的200毫秒子块将四个有效载荷字段置为零,为直接流消费者和RPC提供者带来了潜在风险。

豆包 2.2 发布延期,字节加强 Coding 训练与招聘

流行的比特币钱包面临失去对新硬件设备支持的风险,因关键安全桥梁停止接受新设备
比特币HWI正在冻结对新设备的支持,同时钱包团队评估BHWI的Rust替代品、平衡测试和剩余的集成风险。

Anthropic宣布Claude Code周额度9月14日起减少17%

Refi Hub 联合创始人遭 Claude 恶意链接攻击

Bitcoin Knots再次尝试分叉比特币,因其上一个链在两个区块后崩溃
Bitcoin Knots正在测试BLAKE2b,因BIP-110崩溃,钱包、交易所和重放风险尚未解决。

Rain合约漏洞导致用户损失110万美元

"比特币在五年内达到25万至84万美元的可能性"——River公司基于资金流入模型的预测

MUFG与Progmat启动代币化投资信托的实证实验

Russell 2000 对加密资产交易者的启示
Russell 2000 并不是比特币的预测指标。尽管存在日常相关性,但 S&P 500 的相关性略高,更适合用于确认利率敏感性。

Uniswap的手续费开关如何重新设计收益
Uniswap的手续费开关是一个将交易手续费分配改变并与UNI的销毁相结合的机制,同时也整理了TokenJar和Firepit的角色。

Litecoin的下一次减半期前的现状
Litecoin的下一次减半期将在区块3,360,000时发生,需关注区块高度而非日期。










