快訊

Anthropic 給 Claude 思考鏈上鎖:改一句上下文就作廢,專堵模型蒸餾

BlockBeats 律動財經

動察 Beating AI 快訊,Anthropic 開始給 Claude 的隱藏思考加「上下文鎖」。Fable 5.1 通過 API 生成的加密思考,以後必須和生成它時的系統提示、工具和歷史消息一起原樣傳回來。前面的內容只要被改過,API 就會報錯,或者直接丟掉這段思考。


這項改動就是為了防模型蒸餾。此前研究人員發現,Claude 的加密思考雖然用戶自己看不懂,卻可以重新交給 Anthropic 的兼容模型讀取。攻擊者可以先讓 Opus 產生高質量推理,再把加密塊塞給防護更弱的 Haiku,誘導它把 Opus 的完整思考念出來。相當於不只抄大模型的答案,連草稿紙上的解題過程也一起拿走。



Anthropic 6 月發布 Fable 5 時就堵過一輪,開始把加密思考綁定模型,不能再拿給 Haiku 這類小模型幫忙解密。Fable 5.1 這次又加上「對話綁定」:模型不換,只要改了前面的提示詞、工具或聊天記錄,舊思考同樣作廢。


這道鎖目前還沒有全面打開。8 月 31 日之後新開的 API 帳戶呼叫 Fable 5.1 時才會強制執行,老帳戶暫時不受影響。Claude.ai、Claude Code、Cowork 和其他 Claude 模型也不在範圍內。Anthropic 稱,未來發布的新模型會默認對所有用戶啟用這套規則。

原文連結

發佈者對本文章的內容承擔全部責任
在投資加密貨幣前,請務必深入研究,理解相關風險,並謹慎評估自己的風險承受能力。不要因為短期高回報的誘惑而忽視潛在的重大損失。

暢行幣圈交易全攻略,專家駐群實戰交流

▌立即加入鉅亨買幣實戰交流 LINE 社群(點此入群
不管是新手發問,還是老手交流,只要你想參與加密貨幣現貨交易、合約跟單、合約網格、量化交易、理財產品的投資,都歡迎入群討論學習!

前往鉅亨買幣找交易所優惠


section icon

鉅亨講座

看更多
  • 講座
  • 公告

    Empty
    Empty