Anthropic推出新版本 强化AI模型反蒸馏机制


谈球吧最新动态持续关注中:

北京时间9月2日,Anthropic悄然发布Claude Fable 5.1和Mythos 5.1两大版本。这一更新不仅在8项公开基准测试中均拔得头筹,更在成本控制上取得显著突破:缓存读取价格实现75%的降幅,工作负载总成本降低25%,智能化任务最高可节省45%开支。

值得注意的是,Anthropic在此次更新中引入了关键性的反蒸馏机制。新注册API账号将无法在多轮对话中手动篡改Claude的上下文,同时保留其推理过程。每个思维链区块均被打上数字签名,任何对话前缀的改动都将导致签名失效,API将返回400错误或静默丢弃篡改区块。这一机制与字节跳动创始人张一鸣一个月前提出的"不做蒸馏"策略不谋而合。

蒸馏技术自2015年由Hinton提出以来,一直是AI领域的常见做法:通过强大的"教师模型"训练小型"学生模型",实现低成本高性能。Anthropic此举显然意在遏制这一操作,其理由是"蒸馏能力可能在没有充分保障的情况下被释放"。此前,Anthropic已多次公开指控其他公司进行"工业级蒸馏攻击",此次技术锁堪称是前述指控的实质响应。

在性能表现上,Fable 5.1展现出显著优势。在Terminal-Bench-Science 0.1测试中,Fable 5.1以52.6%的成绩远超上一代24.7%的表现;Terminal-Bench 4.0测试中,Fable 5.1和Mythos 5.1分别达到55.8%和60.9%。CursorBench 3.2.0中,Fable 5.1更以73.4%刷新内部纪录。

about image

Anthropic还展示了智能Agent任务中的成本优化成果:缓存读取价格从每百万token 1美元降至0.25美元,预估普通工作负载总成本可降低25%,重度Agent任务最多可节省45%开支。这一优化将对频繁读写上下文的复杂Agent应用产生显著影响,带来成本结构的大幅改善。

欢迎继续浏览谈球吧(中国)-官方网站的更多精彩内容。