大酷樂
  • 汽車
  • 理财
  • 軍事
  • 科技
  • 遊戲
  • 互聯網
  • 娛樂
  • 财經
  • 科學
  • 社會
  • 親子
  • 電影
  • 健康
  • 教育
  1. 首頁
  2. 科技

谷歌DeepMind研究再登Nature封面,隐形水印讓AI無所遁形

2024-11-08 简体 HK SG TW

今天小編分享的科技經驗:谷歌DeepMind研究再登Nature封面,隐形水印讓AI無所遁形,歡迎閱讀。

君可知,我們每天在網上的見聞,有多少是出自 AI 之手?

除了「注意看!這個男人叫小帥」讓人頭皮發麻,

真正的問題是,我們無法辨别哪些内容是 AI 生成的。

養大了這些擅長一本正經胡說八道的 AI,人類面臨的麻煩也随之而來。

(LLM:人與 AI 之間怎麼連最基本的信任都沒有了?)

子曰,解鈴還須系鈴人。近日,谷歌 DeepMind 團隊發表的一項研究登上了 Nature 期刊的封面:

研究人員開發了一種名為 SynthID-Text 的水印方案,可應用于生產級别的 LLM,跟蹤 AI 生成的文本内容,使其無所遁形。

論文地址:https://www.nature.com/articles/s41586-024-08025-4

一般來說,文本水印跟我們平時看到的圖片水印是不一樣的。

圖片可以采用明顯的防盜水印,或者為了不影響内容觀感而僅僅修改一些像素,人眼發現不了。

但本文添加的水印想要隐形貌似不太容易。

為了不影響 LLM 生成文本的質量,SynthID-Text 使用了一種新穎的采樣算法(Tournament sampling)。

與現有方法相比,檢測率更高,并且能夠通過配置來平衡文本質量與水印的可檢測性。

怎麼證明文本質量不受影響?直接放到自家的 Gemini 和 Gemini Advanced 上實戰。

研究人員評估了實時互動的近 2000 萬個響應,用戶反饋正常。

SynthID-Text 的實現僅僅修改了采樣程式,不影響 LLM 的訓練,同時在推理時的延遲也可以忽略不計。

另外,為了配合 LLM 的實際使用場景,研究者還将水印與推測采樣集成在一起,使之真正應用于生產系統。

大模型的指紋

下面跟小編一起來看下 DeepMind 的水印有何獨到之處。

識别 AI 生成的内容,目前有三種方法。

第一種方法是在 LLM 生成的時候留個底,這在成本和隐私方面都存在問題;

第二種方法是事後檢測,計算文本的統計特征或者訓練 AI 分類器,運行成本很高,且限制在自己的數據網域内;

而第三種就是加水印了,可以在文本生成前(訓練階段,數據驅動水印)、生成過程中、和生成後(基于編輯的水印)添加。

數據驅動水印需要使用特定短語觸發,基于編輯的水印一般是同義詞替換或插入特殊 Unicode 字元。這兩種方法都會在文本中留下明顯的偽影。

SynthID-Text 生成水印

本文的方法則是在生成過程中添加水印。

下圖是标準的 LLM 生成過程:根據之前的 token 計算當前時刻 token 的概率分布,然後采樣輸出 next token。

在此基礎之上,生成水印方案由三個新加入的組件組成(下圖藍色框):随機種子生成器、采樣算法和評分函數。

随機種子生成器在每個生成步驟(t)上提供随機種子 r ( t ) (基于之前的文本 token 以及水印 key),采樣算法使用 r ( t ) 從 LLM 生成的分布中采樣下一個 token。

通過這種方式,采樣算法把水印引入了 next token 中(即 r ( t ) 和 x ( t ) 的相關性),在檢測水印的時候,就使用 Scoring 函數來衡量這種相關性。

下面給出一個具體的例子:簡單來說就是拿水印 key 和前幾個 token(這裡是 4 個),過一個哈希函數,生成了 m 個向量,向量中的每個值對應一個可選的 next token。

然後呢,通過打比賽的方式,從這些 token 中選出一個,也就是 SynthID-Text 使用的 Tournament 采樣算法。

如下圖所示,拿 2^m 個 token 參加 m 輪比賽(這裡為 8 個 token3 輪比賽,token 可重復),

每輪中的 token 根據當前輪次對應的向量兩兩 pk,勝者進入下一輪,如果打平,則随機選一個勝者。

以下是算法的偽代碼:

水印檢測

根據上面的賽制,最終勝出的 token 更有可能在所有的随機水印函數(g1,g2,...,gm)中取值更高,

所以可以使用下面的 Scoring 函數來檢測文本:

把所有的 token 扔進所有的水印函數中,最後計算平均值,則帶水印的文本通常應該得分高于無水印的文本。

由此可知,水印檢測是一個程度的問題。影響評分函數檢測性能的主要因素有兩個。

首先是文本的長度:較長的文本包含更多的水印證據,可以讓檢測有更多的統計确定性。

第二個因素是 LLM 本身的情況。如果 LLM 輸出分布的熵非常低(意味着對相同的提示幾乎總是返回完全相同的響應),那麼錦标賽采樣(Tournament)無法選擇在 g 函數下得分更高的 token。

此時,與其他生成水印的方案類似,對于熵較小的 LLM,水印的效果會較差。

LLM 本身的熵取決于以下幾個因素:

模型(更大或更高級的模型往往更确定,因此熵更低);

來自人類反饋的強化學習會減少熵(也稱為模式崩潰);

LLM 的提示、溫度和其他解碼設定(比如 top-k 采樣設定)。

一般來說,增加比賽的輪數(m),可以提高方法的檢測性能,并降低 Scoring 函數的方差。

但是,可檢測性不會随着層數的增加而無限增加。比賽的每一層都使用一些可用的熵來嵌入水印,水印強度會随着層數的加深而逐漸減弱。本文通過實驗确定 m=30。

文本質量

作者為非失真給出了由弱到強的明确定義:

最弱的版本是單 token 非失真,表示水印采樣算法生成的 token 的平均分布等于 LLM 原始輸出的分布;

更強的版本将此定義擴展到一個或多個文本序列,确保平均而言,水印方案生成特定文本或文本序列的概率與原始輸出的分布相同。

當 Tournament 采樣為每場比賽配置恰好兩個參賽者時,就是單 token 非失真的。而如果應用重復的上下文掩碼,則可以使一個或多個序列的方案不失真。

在本文的實驗中,作者将 SynthID-Text 配置為單序列非失真,這樣可以保持文本質量并提供良好的可檢測性,同時在一定程度上減少響應間的多樣性。

計算可擴展性

生成水印方案的計算成本通常較低,因為文本生成過程僅涉及對采樣層的修改。

對于 Tournament 采樣,在某些情況下,還可以使用矢量化來實現更高效率,在實踐中,SynthID-Text 引起的額外延遲可以忽略不計。

在大規模產品化系統中,文本生成過程通常比之前描述的簡單循環更復雜。

產品化系統通常使用 speculative sampling 來加速大模型的文本生成。

小編曾在将 Llama 訓練成 Mamba 的文章中,介紹過大模型的推測解碼過程。

簡單來說就是用原來的大模型蒸餾出一個小模型,小模型跑得快,先生成出一個序列,大模型再對這個序列進行驗證,由于 kv cache 的特性,發現不符合要求的 token,可以精準回滾。

這樣的做法既保證了輸出的質量,又充分利用了顯卡的計算能力,當然主要的目的是為了加速。

所以在實踐中,生成水印的方案需要與推測采樣相結合,才能真正應用于生產系統。

對此,研究人員提出了兩種帶有推測采樣算法的生成水印。

一是高可檢測性水印推測采樣,保留了水印的可檢測性,但可能會降低推測采樣的效率(從而增加整體延遲)。

二是快速水印推測采樣,(當水印是單 token 非失真時)保留了推測采樣的效率,但可能會降低水印的可檢測性。

作者還提出了一個可學習的貝葉斯評分函數,以提高後一種方法的可檢測性。當速度在生產環境中很重要時,快速帶水印的推測采樣最有用。

上圖表明,在非失真類别中,對于相同長度的文本,非失真 SynthID-Text 提供比 Gumbel 采樣更好的可檢測性。在較低熵的設定(如較低的溫度)下,SynthID-Text 對 Gumbel 采樣的改進更大。

熱門排行
  • 王治郅:楊瀚森主要的問題是速度 他的速度跟不上現代籃球的節奏 王治郅:楊瀚森主要的問題是速度 他的速度跟 郟君昊 | 2025-05-05
  • 貿易戰燒進電影院:特朗普拟重稅打擊外國電影 逼好萊塢等回美拍片 貿易戰燒進電影院:特朗普拟重稅打擊外國電影 習又夏 | 2025-05-05
  • 貸款追高炒黃金的人後悔了!有人一天虧掉6年工資,賣掉舍不得,不賣扛不住 貸款追高炒黃金的人後悔了!有人一天虧掉6年 寸飛蘭 | 2025-05-05
  • 手機電池突破8000mAh?矽碳技術的回旋镖:「折壽」換容量 手機電池突破8000mAh?矽碳技術的回旋镖:「折 衛青柏 | 2025-05-05
  • 貸款追高炒黃金的人後悔了!有人一天虧掉6年工資,賣掉舍不得,不賣扛不住 貸款追高炒黃金的人後悔了!有人一天虧掉6年 繁綺文 | 2025-05-05
  • 任天堂對Genki提起Switch 2商标侵權訴訟,後者回應稱将嚴肅對待 任天堂對Genki提起Switch 2商标侵權訴訟,後 郜萌運 | 2025-05-05
  • 哪吒汽車APP和官網恢復正常 知情人士:之前斷網因流量欠費 哪吒汽車APP和官網恢復正常 知情人士:之前斷 袁曼雁 | 2025-05-05
  • 極越汽車 CEO 夏一平名下青島/義烏兩家公司被列入經營異常 極越汽車 CEO 夏一平名下青島/義烏兩家公司 集玲琳 | 2025-05-05
  • 全國經濟第一大省明确,推動組建農商聯合銀行 全國經濟第一大省明确,推動組建農商聯合銀行 佼昌翰 | 2025-05-05
  • 桑保利:亞馬爾有配合意識&有點像梅西 姆巴佩更專注進球&更像C羅 桑保利:亞馬爾有配合意識&有點像梅西 姆巴佩 甄正浩 | 2025-05-05
  • 高露現身上海虹橋機場 黑色外套點綴亮色愛心裝飾俏皮亮眼 高露現身上海虹橋機場 黑色外套點綴亮色愛 惠惠君 | 2023-05-02
  • 《歧路旅人2》:向光而生 《歧路旅人2》:向光而生 衛青柏 | 2023-05-02
  • vivo X90S曝光:處理器更新為天玑9200+ 安卓最強芯 vivo X90S曝光:處理器更新為天玑9200+ 安卓最 袁曼雁 | 2023-05-05
  • “懶癌”發病率上升,定期體檢别忽視 “懶癌”發病率上升,定期體檢别忽視 幸聽楓 | 2023-05-02
  • 宋慧喬獲百想視後 韓素希發圖手動加愛心表情慶祝 宋慧喬獲百想視後 韓素希發圖手動加愛心表 賁芳蕤 | 2023-05-02
  • 曹操墓,裡面都有啥? 曹操墓,裡面都有啥? 衛青柏 | 2023-05-02
  • 十年了,他們終于要HE! 十年了,他們終于要HE! 惠惠君 | 2023-05-07
  • 中央部署經濟工作,釋放5大信号 中央部署經濟工作,釋放5大信号 郜萌運 | 2023-05-02
  • 高德上線手機彎道會車預警功能 高德上線手機彎道會車預警功能 習又夏 | 2023-05-02
  • 陳自瑤抱病為愛女做蛋糕慶生,王浩信點贊沒露面 陳自瑤抱病為愛女做蛋糕慶生,王浩信點贊沒露 賁芳蕤 | 2023-05-02
  • 等比例長大的童星,李蘭迪算一個 等比例長大的童星,李蘭迪算一個 郟君昊 | 2023-05-02
  • 這些被抓來做實驗的流浪狗,最終拯救了無數糖尿病人 這些被抓來做實驗的流浪狗,最終拯救了無數糖 集玲琳 | 2023-05-02
  • 高端國產車:軍車血統,目前電動車越野的“天花板”? 高端國產車:軍車血統,目前電動車越野的“天花 謝飛揚 | 2023-05-02
  • 《雲襄傳》終于抬上來啦,男O女A讓人好上頭! 《雲襄傳》終于抬上來啦,男O女A讓人好上頭! 集玲琳 | 2023-05-02
  • 21家A股遊戲公司2022年收入651億 今年“遊戲+AI”能否逆風翻盤? 21家A股遊戲公司2022年收入651億 今年“遊 衛青柏 | 2023-05-04
  • 與周立波夫婦鬧糾紛成老賴,唐爽被司法拘留15日 與周立波夫婦鬧糾紛成老賴,唐爽被司法拘留15 寸飛蘭 | 2023-05-05
  • 信用風險釋放趨緩,結構性風險需重點關注 ——2023年一季度債市信用風險回顧與下階段展望 信用風險釋放趨緩,結構性風險需重點關注 — 袁曼雁 | 2023-05-02
  • 普京籤署總統令,批準對俄刑法典相關法條的修正案 普京籤署總統令,批準對俄刑法典相關法條的修 集玲琳 | 2023-05-02
  • 中銀證券給予南京銀行增持評級 中銀證券給予南京銀行增持評級 袁曼雁 | 2023-05-03
  • 解除資格!停止一切合作 解除資格!停止一切合作 佼昌翰 | 2023-05-02
  • 3699起 聯想小新mini主機上架 13代酷睿标壓處理器 3699起 聯想小新mini主機上架 13代酷睿标壓 習又夏 | 2023-05-05
  • 前董事長被免,天山生物全面進入“中植系”時代?股價曾在一月内暴漲超400% 前董事長被免,天山生物全面進入“中植系”時 惠惠君 | 2023-05-02
  • 瘋成這樣,怎麼還能被全網吹捧? 瘋成這樣,怎麼還能被全網吹捧? 郜萌運 | 2023-05-02
  • 狂吼11次“讓一下”!交警咆哮開道嘶吼到吐 狂吼11次“讓一下”!交警咆哮開道嘶吼到吐 寸飛蘭 | 2023-05-03
  • 摩根大通收購美國第一共和銀行 摩根大通收購美國第一共和銀行 謝飛揚 | 2023-05-02
  • 台劇赢麻了,又來一部8.9 台劇赢麻了,又來一部8.9 衛青柏 | 2023-05-02
  • 下降45分,上漲35分!34所自劃線院校復試分數線漲幅匯總 下降45分,上漲35分!34所自劃線院校復試分數線 袁曼雁 | 2023-05-07
  • 事關農村土地承包和農民權益,《農村土地承包合同管理辦法》5月1日起施行 事關農村土地承包和農民權益,《農村土地承包 郟君昊 | 2023-05-02
  • "三高"已盯上青少年,做好這件事是關鍵 "三高"已盯上青少年,做好這件事是關鍵 習又夏 | 2023-05-05
  • 五一檔沒一個能打的 五一檔沒一個能打的 集玲琳 | 2023-05-05
  • 恐怖韓劇下神壇,這次膽小可入 恐怖韓劇下神壇,這次膽小可入 袁曼雁 | 2023-05-05
  • 這劇是不是用ChatGPT寫的呀? 這劇是不是用ChatGPT寫的呀? 惠惠君 | 2023-05-02
  • 200戶連夜疏散,原因讓人憤怒!“損失超一億”,官方通報 200戶連夜疏散,原因讓人憤怒!“損失超一億”, 袁曼雁 | 2023-05-03
  • 性騷擾慣犯,滾出娛樂圈 性騷擾慣犯,滾出娛樂圈 謝飛揚 | 2023-05-05
  • 48歲何炅自曝已老花眼,黃磊睡前認老,《向往的生活》證實将停辦 48歲何炅自曝已老花眼,黃磊睡前認老,《向往的 佼昌翰 | 2023-05-02
  • 一個《長月燼明》倒了,《狐妖》《長相思》《與鳳行》…在路上了 一個《長月燼明》倒了,《狐妖》《長相思》《 惠惠君 | 2023-05-02
  • 張天愛假期曬“酷”存照 卷發披肩穿黑色吊帶裙大秀好身材 張天愛假期曬“酷”存照 卷發披肩穿黑色吊 嬴覓晴 | 2023-05-02
  • 當年輕人開始不随份子錢 當年輕人開始不随份子錢 袁曼雁 | 2023-05-02
  • 畢滢用8年時間成功逼宮?曾被傳已婚生子的她,不容小觑 畢滢用8年時間成功逼宮?曾被傳已婚生子的她, 幸聽楓 | 2023-05-03
  • 宋慧喬獲視後首次曬照,拿獎杯笑容溫柔 宋慧喬獲視後首次曬照,拿獎杯笑容溫柔 郜萌運 | 2023-05-02

©2022 大酷樂 版權所有

隱私政策 | 服務條款 | 聯繫我們