Claude 將在文本中加入不可見的水印:能提示模型參與,但不能代替人類判定作者
CoinMeta
09-02 11:26
Ai 焦點
Anthropic 在9月1日宣布,未來的 Claude 模型將逐步為生成的文本加入不可見的水印,并向符合條件的機構開放檢測接口的私人測試。這並不是在句子中塞入肉眼看不到的字符,也不是給每篇文章附上一串用戶編號,而是通過在多個同樣合理的詞語之間輕微調整選擇概率,讓較長的文本呈現出可被統計識別的模式。
有幫助
No.幫助

Anthropic 在9月1日宣布,未來的 Claude 模型將逐步為生成的文本加入不可見的水印,並向符合條件的機構開放檢測接口的私人測試。這並不是在句子中塞入肉眼看不到的字符,也不是給每篇文章附上一串用戶編號,而是通過在多個同樣合理的詞語之間輕微調整選擇概率,讓較長的文本呈現出可被統計識別的模式。

該公司採用了 SynthID-Text 的一種實現方式,稱該機制不會增加 Token 的輸出,在內部評估中也未發現可操作的品質下降。水印將在全球新模型上啟用,舊模型將有過渡期,整體推出不預計會持續數月。Anthropic 明確承認,目前沒有可靠的方法可以按地區長期隔離這種機制,因此選擇統一部署,而不是只在歐盟提供。

這項安排與歐盟的《人工智能法》及其通用人工智能模型實踐準則有關。Anthropic在2026年7月簽署了該準則,相關的透明性要求於8月2日開始適用。不過,將合規行為理解為「AI文本之後都能驗明正身」會嚴重誇大其效果。官方對水印的定位非常謹慎:檢測結果只能說明Claude可能參與了文本的生成,但不能證明文本究竟是由人還是AI完成的,更無法識別具體的用戶、組織或對話。

水印改變的是詞語的概率,而不是給每篇文章蓋上唯一的身份章

大模型在生成一句话時,通常會有多個意義相近、語法正確的下一個詞的候選。水印系統使用一個秘密規則,對這些候選的抽取概率進行微小的偏移。單個詞看不出異常,但在足夠長的文本中,這些偏移會累積成統計信號。檢測器根據這個信號來估計文本是否與 Claude 的水印分佈相符,而不是在文件中尋找一個固定的標記。

這種設計有兩個直接的好處。第一,即使複製到純文本中、更改字體或截去檔案元數資料之後,訊息仍有可能被保留;第二,它不會像零寬字元那樣被簡單的格式清理立即刪除。同時,它的證據性質也較弱:統計相關並不等於身份證明。兩個人獨立寫出的短句可能相似,多個模型和人工編輯也可能共同完成一篇文章,檢測器只能給出概率判斷。

Anthropic 列出了多项限制。短文本沒有足夠樣本,檢測效果會下降;事實性很強的段落可選擇措辭較少,信號空間有限;代碼需要精確輸出,不適合自由改變詞語;只進行輕微編輯可能會保留水印,大幅改寫、翻譯或讓另一個模型重述,則可能會把信號洗掉。因此它更適合調查來源不明的長篇材料,不能作為考試作弊或新聞造假的單一裁決工具。

水印也不會編碼個人信息。Anthropic 表示,這種機制不能指向某個賬戶、企業或聊天記錄。這一限制降低了水印成為跨文本追蹤器的風險,但同時也意味著平台無法僅憑檢測結果來回答「是誰生成的」。如果機構需要審計具體的工作流程,仍需依賴於賬戶日誌、版本記錄、引用鏈和人工聲明,不能將責任追蹤外包給一個數值。

檢測接口先提供給專業機構,真正的難題在於如何避免將概率當作判決。

首批私測對象包括符合條件的監管機構、媒體與事實核查組織、研究人員、教育機構、歐盟民間社會組織,以及承擔相關義務的企業。Anthropic 計劃逐步擴大範圍,而不是立即提供一個人人可用的公開檢測網頁。這樣做有現實原因:如果攻擊者可以無限次試驗文本並即時得到結果,就更容易反向尋找去除水印的方法;專業用戶也更有條件理解誤報和漏報。

生成文件還會有另一層標記。對於受支持的檔案類型,Claude 將使用 C2PA 內容憑證來保存來源元資料。C2PA 與文本水印解決的是不同問題:前者更像是隨檔案攜帶的可驗證履歷,適合未被剝離元資料的原始檔案;後者則嵌入在語言分佈中,更能承受複製貼粘,但結論更偏向於概率化。兩者疊加仍然無法覆蓋截圖、重寫和跨模型加工的所有情況。

學校、編輯部門和平台最容易犯的錯誤,就是將檢測閾值直接設定為處罰閾值。水印檢測應該觸發進一步的核實,例如查看寫作過程、草稿和引用等,而不應該單獨決定學生是否作弊、作者是否造假。機構還需要保存模型版本和檢測器版本,因為算法升級後,同一段文本的評分標準可能會發生變化。在對外發布結論時,也應該說明樣本長度、編輯歷史和不確定性,而不是只展示一個百分比。

水印的价值不在于製造一臺「AI 誊言測試儀」,而在于為來源調查增加一條機器可讀的線索。當越來越多內容經過模型輔助之後,二進制問題「是否是 AI 寫的」本身就會失去意義,更有用的是 AI 參與了哪些環節、最終責任由誰承擔、證據鏈是否完整。Anthropic 這次提供的是一項有限但可部署的技術措施;只有配合日誌、內容憑證和人類的程序正義,它才有可能提升透明度,而不是製造新的誤判。

打賞
$0
點讚
0
收藏
0
瀏覽量 63
HQYC提醒,請廣大讀者理性看待區塊鏈,切實提高風險意識,警惕各類虛擬代幣發行與炒作,站內所有內容僅係市場資訊或相關方觀點,不構成任何形式的投資建議。如發現站內內容含敏感資訊,可點擊“舉報”,我們會及時處理。
提交
評論 0
最熱
最新
還沒有人評論喔~快搶沙發吧!
相關閱讀
web3:Ultrahuman獲得7000萬美元融資,推進AI智能手環
Ultrahuman 完成7000万美元融资,并與高通合作開發支持本地軟件和 AI 交互的新一代智能戒指。
TechCrunch
·2026-09-04 01:23:37
0
web3 : Rain 升級預測市場工具,鯨魚增持 RAIN
Rain Protocol完成產品升級與代幣銷毀後,鏈上大額持倉地址在8月明顯增倉,RAIN價格接近前高。
CoinPedia
·2026-09-04 01:23:34
0
web3 : Circular 推出 Ring 3系列,新增 NFC 支付與震動提醒功能
Circular 推出 Ring 系列智能戒指,新增 NFC 支付、震动提醒及健康追踪功能,预计2027年初開售。
TechCrunch
·2026-09-04 00:58:32
15
web3:外媒:Scaramucci借G20债务表态重申比特币叙事
贝森特在 G20 谈及全球債務壓力後,Scaramucci 借機重申比特幣的長期發展觀點。
U.Today
·2026-09-04 00:45:33
17
web3:索尼反駁PS5買家5.08億美元退款的訴求
索尼要求駁回 PS5 涨價退款的訴訟,稱關稅與漲價之間的因果關係缺乏依據。
Coinpaper
·2026-09-04 00:45:30
15
查看更多