
商傳媒|林昭衡/綜合外電報導
隨著人工智慧(AI)生成內容的快速發展,如何辨識內容真偽成為一項嚴峻挑戰。近日,人工智慧公司 Anthropic 為旗下 Claude 模型推出的「隱形浮水印」技術,原本是為了配合歐盟《人工智慧法案》而實施,卻意外催生了一批專門用於繞過或移除這些浮水印的工具,顯示這場 AI 內容辨識的攻防戰正逐漸白熱化。
Anthropic 於上週宣布,其部分 Claude 模型產出的文字內容將內嵌一種「隱形浮水印」。這種 AI watermarking(人工智慧浮水印)技術透過 Claude 在文字選用上的統計模式來建立,目的是讓這些由人工智慧內容生成(利用 AI 模型自動產出文本、圖像、音訊等內容)的標記能隨內容複製貼上而持續存在,進而辨識其為 AI 所生成。
然而,這項技術隨即引發部分用戶的擔憂,特別是若僅將 Claude 用於校對、翻譯或摘要等輕度編輯工作時,浮水印仍可能被植入。此疑慮導致一些用戶取消了他們的 Claude 訂閱服務。根據外媒報導,在美國地區,谷歌趨勢(Google Trends)中「AI watermark remover」(AI浮水印移除工具)的搜尋量在一週內增長了 60%,凸顯市場對這類工具的強烈需求。
為回應這波需求,軟體開發者和企業家迅速推出了多款 AI 浮水印移除工具。例如,Memo 創辦人 Guillaume Meyer 便發布了一個名為「Watermarks Remover」的開源專案。該工具旨在移除隱藏字元和元資料,並透過改寫文字來擾亂浮水印模式。據 Meyer 表示,這項工具僅花了約五小時便完成開發,目前已在 GitHub 上獲得超過 14,000 個星號,儘管它不保證能完全移除浮水印。Meyer 認為,浮水印技術將「作者身份視為二元概念,即使是輕度 AI 編輯也會被標記,這是解決真正問題的錯誤方法」。
此外,AI 教育家 Sabrina Ramonov 也推出了一款免費、基於瀏覽器的「Watermark Remover」工具,而軟體開發者 Ansh Aneja 則開發了針對 Claude 的浮水印移除工具 MarkScrub。據稱 MarkScrub 在一天內用戶數便從零增長至 8,500 人。不過,這些新興移除工具的實際效果尚未經過獨立驗證。
這類 AI 浮水印移除工具的合法性仍存在「灰色地帶」。歐盟《人工智慧法案》雖要求 AI 供應商確保內容的可辨識性,但並未明確規範第三方移除工具的行為。歐盟執委會(European Commission)發言人表示,AI 供應商的標記系統必須能承受常見的修改和惡意行為,包括移除。蘇黎世聯邦理工學院(ETH Zurich)研究員 Thibaud Gloaguen 指出,透過重寫整個文本等方式,總會有辦法移除浮水印。
馬斯特裡赫特大學(Maastricht University)助理教授 Konrad Kollnig 則表示,無論是歐盟《人工智慧法案》還是 Anthropic 的服務條款,目前都沒有禁止開發或分享浮水印移除工具的條文。然而,若用戶利用這些工具將 AI 生成內容冒充為人類作品,則可能違反 Anthropic 禁止冒充人類的使用政策。Anthropic 預計將隨其下一代模型發布文字偵測 API,這可能進一步影響 AI 生成文本的使用。

