S2E67 AI 浮水印深入解析:為什麼 OpenAI 做好了卻不敢用?

August 16
18 mins

View Transcript

Episode Description

如果你喜歡我的內容,歡迎加入會員支持我,讓我把內容做得更深、做得更好,一起把這個頻道做成我們都想看到的樣子!

👉 https://www.youtube.com/channel/UCJIPFjZSCWR15_jxBaK2fQQ/join


Anthropic 最近宣布要在他們所有文字模型的產出上加浮水印。一開始我以為只是他們自己的政策,結果背後是歐盟一條 8 月 2 號生效的新法,Gemini、OpenAI、Grok 這些主流模型全都得跟。而且它管的不只是歐洲人,模型也分不出你是不是歐洲人,所以 12 月 2 號之後連舊模型都要補上,你平常在用的這些工具,產出的東西大概都會帶著一個你看不到的記號。


這集我把文字、圖片、聲音、影像這四種浮水印怎麼藏進去、又怎麼被抓出來,一種一種講清楚。圖片、影像、聲音這三種其實蠻像的,都是靠一組神經網路,把肉眼肉耳都察覺不到的訊號嵌進去。聲音那段我自己覺得最有意思,它得先把聲波變成一張圖,在圖上動完手腳,再變回聲音。文字就完全是另一套邏輯了,2023 年那篇開山論文用的方法我把它叫做「紅綠燈」,很聰明,但也有它的代價,後來 Google 的 SynthID 才又想辦法補回來。


中間有一段講到 OpenAI。他們其實 2024 年就把文字浮水印做得差不多了,準確度號稱可以到 99.99%,本來都要推出了。結果他們做了一份問卷問使用者,看到某個回覆之後,就把這個功能收起來,一路藏到現在。一家整天在講安全、講透明的公司,手上有一個能證明「這是我做的」的工具卻選擇不放,他們到底在顧慮什麼,我覺得蠻值得想的。


從這件事我也延伸聊了一個比較個人的問題:既然 AI 產的東西以後都有記號了,那我們在工作上、在創作上,到底還該不該用 AI。我的想法是沒有標準答案,差別在於這件事對你來說是一個省事的手段,還是一件你本來就享受在做的事。我拿曼尼很愛寫作這件事當例子,也講了為什麼我自己反而蠻放心把文字交給 AI。


後半我把現在浮水印技術還解不掉的問題整理成三個難題,其中一個會用小時候玩的「尋找威利」來解釋什麼是零知識驗證。而文字浮水印最尷尬的地方是,它基本上防君子不防小人,一個大部分人都做得到的小動作,就能讓整個記號失效。至於是哪個動作,我在影片裡會講。


如果有一天你用 AI 產的每一段文字、每一張圖都被標上記號,你會因此少用,還是根本不在意?看完歡迎在下面留言。


🔗 《矽谷輕鬆談》傳送門 👉 https://linktr.ee/jktech


(00:00) 開頭:歐盟新法上路,全世界的 AI 內容都要加浮水印

(01:14) 倒帶 2023:Google SynthID,浮水印的開山祖師

(02:03) OpenAI 早就做好文字浮水印,為什麼選擇不用

(02:44) 該不該幫 AI 內容加浮水印,又該不該用 AI 創作

(03:29) 曼尼很愛寫作,而我為什麼放心把文字交給 AI

(05:15) 圖片、聲音、影像的浮水印是怎麼藏進去的

(06:37) 聲音浮水印最有趣:先變成頻譜圖再動手腳

(07:25) 這集重點:文字浮水印的「紅綠燈」方法

(10:28) 紅綠燈的副作用,跟 SynthID 的加強版

(13:19) 現在浮水印技術的三大難題

(13:53) 用「尋找威利」秒懂零知識驗證

(16:23) 防君子不防小人:一次翻譯就能讓浮水印失效


See all episodes