社群媒體平台上的人工智慧會從你的內容中學習:以下是如何阻止它(有時)的方法

社群媒體平台會利用您的內容來訓練人工智慧模型。了解您可以採取哪些措施來保護您的資料並限制這種使用。

你需要知道的最重要的事情

  • 大多數社群媒體平台將登入視為同意使用您的資料來訓練人工智慧模型,因此在許多情況下,選擇退出這種訓練非常困難或不可能。
  • LinkedIn、Snapchat、Twitch 和 X 等平台的使用者可以透過專門的隱私或安全設定來停止使用其資料進行 AI 訓練。
  • Facebook、Instagram、Reddit 和 TikTok 等主流平台沒有提供直接退出 AI 訓練的選項,刪除帳戶往往是唯一可行的解​​決方案。

亞馬遜旗下的Twitch最近宣布將允許用戶選擇不讓其直播、點播影片和聊天記錄被用於訓練人工智慧模型,這一消息迅速成為新聞熱點。此舉自然招致了許多批評。然而,事實證明,Twitch在這方面或許算是比較溫和的社群媒體平台之一。大多數社群媒體應用程式都會利用用戶資料訓練某種形式的人工智慧,而像Twitch這樣提供簡單易用的單鍵退出選項的平台卻寥寥無幾。

社群媒體平台上的人工智慧會從你的內容中學習:以下是如何阻止它(有時)的方法

如今,幾乎所有社群媒體平台都讓用戶難以確切了解自己的資料是如何被使用的。像Google的Gemini這樣的生成式人工智慧模型,通常會與更傳統的(但同樣基於機器學習的)功能(例如YouTube的演算法)混合使用。深入研究社交應用的隱私權政策,以確定是否使用了備受爭議的生成式人工智慧,這項工作恐怕會讓大多數律師望而卻步。

即使你發現了你的資料是如何被使用的,很多網站根本不提供退出選項。在我調查的所有網站中,沒有一個訓練人工智慧的網站提供加入表單。實際上,如果你今天登錄,科技公司就認為你同意將你的資料納入他們的訓練資料中。不過,如果某個社群媒體網站提供了退出人工智慧訓練的方法,你可以在下面的清單中找到相關說明,清單按字母順序排列。

藍天

你們進行的是哪種類型的訓練?官方說法是,Bluesky 並沒有訓練任何 AI 模型——儘管它在開發過程中確實使用了 AI,並建立了 AI 驅動的功能。然而,由於 Bluesky 使用的是去中心化的 AT 協議,你的貼文(以及許多其他數據,例如你封鎖了哪些人)都是公開的。因此,幾乎任何人都可以收集你的貼文並用它們來訓練 AI。

如何阻止這種情況?其實你不需要做任何事;Bluesky 本身並不會使用你的貼文來訓練其人工智慧。但是,如果你擔心第三方會收集你的數據,你或許應該停止向他們發佈內容。

Facebook

它究竟在進行什麼樣的訓練?或許更簡單的問題是:Facebook 究竟*不*使用哪些資料來訓練其人工智慧? Facebook 的母公司 Meta 在打造一個從未實現的元宇宙專案上投入了相當於一個小國 GDP的巨資,如今卻轉向人工智慧,並競相追趕OpenAI、Anthropic 和 Google 等公司。該公司關於使用用戶資料訓練人工智慧的政策極為寬泛,不僅涵蓋用戶在 Facebook 上的貼文、照片和互動,還包括從第三方中介機構收集的數據以及「線上可取得的資訊」。這個措辭如此寬泛,以至於很難想像 Facebook 究竟能收集到哪些數據,而它又會避免使用這些數據。 Facebook 表示,它只會在用戶與朋友或家人之間的私人資訊用於訓練人工智慧時才會停止,「除非您或對話中的其他人選擇與我們的人工智慧系統分享這些資訊」。

如何阻止這種情況?遺憾的是,除非你住在歐盟,否則Facebook不允許你選擇退出使用你的資料進行人工智慧訓練。該公司僅在法律有義務的情況下,才會對特定情況做出例外規定:當你在其人工智慧工具的回覆中發現包含你的個人識別資訊時,才會允許你這樣做。如果發生這種情況,你可以提出投訴,Facebook將進行審查並決定是否採取任何行動。

然而,請記住,Meta 將您與 Facebook 的 AI 工具互動視為您同意他們利用您的互動資料來訓練未來的 AI 模型。因此,即使只是嘗試了解您的個人資訊是否已被收集,也可能使您面臨更大的風險。總而言之,似乎對抗 Facebook 的唯一方法就是不參與。不過值得注意的是,即使刪除您的 Facebook 帳戶也未必能阻止 Facebook 使用您的資料訓練其 AI——它只會阻止他們直接從您的 Facebook 帳戶存取任何資料。

Instagram

你們在進行哪種類型的培訓? Instagram 隸屬於 Meta,也就是 Facebook 的母公司,因此它的許多政策與我們在上一節討論的 Facebook 政策類似。然而,Instagram 本身也存在一些問題,例如 Muse 功能。該功能曾短暫地允許用戶在未經他人同意的情況下,利用人工智慧技術創建他人的圖像,但在意識到這是一個非常糟糕的主意後,很快就將其移除。

如何阻止這種情況?與 Facebook 類似,如果您發現人工智慧回覆包含您的個人訊息,您可以提出異議;如果您身處歐盟,則可以完全選擇退出訓練。或者,您唯一真正的選擇是刪除您的 Instagram 帳戶,或至少將其設定為私人帳戶。

LinkedIn

你們在進行什麼類型的訓練? LinkedIn隸屬於微軟,而微軟以大力涉足人工智慧領域(僅供娛樂)而聞名,因此您應該警惕該網站使用您的資料來訓練人工智慧。根據LinkedIn的官方政策,用戶的貼文、評論、個人資料、個人簡介和群組活動等資料均可用於訓練人工智慧模型。值得注意的是,LinkedIn去年曾因被指控利用私訊(DM)訓練人工智慧而面臨訴訟——LinkedIn否認了這些指控。這些問題引發了人們對人工智慧機器人安全性和資料使用方式的擔憂。

如何阻止這種情況?雖然 LinkedIn 和其他大多數公司一樣採用「事後請求原諒」的模式,但至少網站允許您撤銷授權。在網站上,依序點選「設定與隱私權」>「資料隱私」>「LinkedIn 如何使用您的資料」>「用於產生式 AI 改進的資料」。在這裡,您會找到一個預設啟用的開關,標籤為「使用我的資料訓練內容創建 AI 模型」。將其關閉。注意:這僅適用於在 LinkedIn 上收集的數據,不適用於更廣泛的微軟生態系統。

Reddit

Reddit 正在進行哪種類型的訓練?情況比較複雜:該公司並非自行訓練 AI 模型,而是與OpenAI和Google達成協議,利用其資料訓練這兩家公司的模型。要進一步比較這些模型,可以查看ChatGPT 中 Gemini 仍然缺少的功能。根據報道,Reddit 曾考慮終止這些協議(至少部分原因是,與許多其他公司一樣,隨著 AI 佔據搜尋市場份額,Reddit 的流量有所下降)。但早在這些協議正式達成之前,AI 模型就已經開始使用 Reddit 的資料進行訓練,因此很難說終止正式合作關係是否會阻止 AI 公司盡可能收集公開資料。

如何阻止這種情況?除了刪除你的Reddit帳號並完全停止發文之外,你別無他法。 Reddit目前沒有提供任何工具來禁用AI訓練。即便有這樣的工具,AI公司早已開始收集公開貼文了。

Snapchat

他們進行什麼樣的訓練?和大多數社群媒體應用程式一樣,Snapchat 使用用戶公開的照片、影片和音訊來訓練其生成式人工智慧模型。該公司表示,他們利用這些數據開發 AI Snap 和 AI Lenses 等功能。 Snapchat 也曾短暫地與 Perplexity 達成協議,將 Perplexity 的人工智慧工具整合到其搜尋功能中,但該協議在去年大規模推廣之前「雙方終止」,因此目前尚不清楚是否有任何用戶資料與 Perplexity 共享或使用 Perplexity 進行訓練。

如何阻止這種情況發生?與大多數社群媒體應用程式不同,在 Snapchat 中選擇退出相對簡單(雖然有點隱密)。在應用程式內,開啟「設定」 ,在「隱私控制」下,點選「生成式 AI 設定」。在這裡,關閉標有“允許使用公開內容”的開關。就這麼簡單。當然,第三方收集公開數據並非不可能,儘管 Snapchat 的設計讓這種情況更難發生。如果您想更加安全,請避免在個人資料中留下任何永久性的公開內容。

Threads

他們進行什麼樣的訓練? Threads 隸屬於 Facebook 的母公司 Meta,因此它遵循與 Facebook 相同的資料訓練政策。這意味著,除非法律絕對要求,否則無論您是否同意,Threads 上的公開資料都將用於訓練人工智慧,而且您無法選擇退出。

如何阻止這種情況?如果您身處歐盟,可以按照與 Facebook 帳號相同的流程提出異議。如果您身處美國,則需要提交投訴,證明您的個人資料出現在人工智慧的回覆中,才能要求刪除部分資料。否則,您只能選擇將 Threads 帳戶設為私人帳戶或徹底刪除該帳戶。

TikTok

他們進行什麼樣的訓練? TikTok 的人工智慧訓練政策比 Facebook 的更複雜,因為該公司今年稍早不得不將其美國業務分拆為獨立實體。通常情況下,TikTok 的母公司位元組跳動會使用使用者資料訓練其人工智慧模型,但如果您身處美國,這些資料可能會用於其他用途,例如訓練推薦系統,並且不允許用於訓練位元組跳動的通用人工智慧模型。

如何阻止這種情況?就像 Facebook 一樣,如果您想選擇不讓 AI 使用您的資料進行訓練,您需要提交一份具體的反對意見,說明是否有違反您當地法律的隱私侵犯行為。換句話說,您不能簡單地說「請不要使用我的資料進行訓練」。您可以造訪此頁面,找到適合您所在地區的表格。

在這種情況下,我們通常建議將帳號設為私密是最後的選擇,但有報道稱,TikTok 甚至會利用私密影片和未儲存的草稿來訓練其人工智慧模型。因此,防止 TikTok 利用你的資料訓練人工智慧的最可靠方法是徹底刪除你的帳號。

Twitch

他們正在進行什麼樣的訓練? Twitch 的政策允許使用你的直播串流、點播影片、剪輯片段、直播聊天記錄,甚至頻道中的圖片和文字來訓練生成式人工智慧模型。目前尚不清楚 Twitch 將利用這些數據開發哪些功能。該公司在其常見問題解答頁面中提到了字幕等功能,但自動字幕功能出現的時間遠早於我們今天所知的生成式人工智慧模型。

如何阻止這種情況?如果您在 Twitch 上經營頻道,可以前往Twitch 的安全設置,向下捲動找到「用於生成式 AI 的訓練」選項,然後將其關閉。是的,此選項預設為啟用,Twitch 也知道這會帶來不良後果。需要注意的是,此設定僅適用於您自己的頻道。如果您出現在其他用戶的直播間或在他們的聊天室中發言,則您產生的任何資料都將受他們的退出設定約束。

X

他們正在進行哪種類型的訓練? X 不僅僅使用你的貼文和公開資料來訓練其 Grok AI 模型;自從該公司與 xAI 和 SpaceX 合併以來,你的資料可能被用於訓練整個公司的 AI 模型。我只能根據該網站的公開政策進行推測;然而,值得注意的是,SpaceX 和 xAI 的執行長馬斯克以漠視法律甚至安全規程而聞名。因此,在評估風險並決定如何處理你的數據時,請務必牢記這一點。

如何阻止這種情況?幸運的是,x 提供了一種選擇退出使用您的資料進行 AI 訓練的方法。前往「設定」>「隱私與安全」,向下捲動至「資料共享與個人化」。在這裡,選擇“Grok 和第三方合作者”。在此頁面上,您會看到幾個需要取消勾選的複選框,其中最值得注意的是以下冗長的聲明:“允許您的公開數據以及您與 Grok 和 xAI 的互動、輸入和結果用於訓練和微調。”

YouTube

他們到底在進行什麼樣的訓練?就人工智慧訓練而言,YouTube 簡直是隱私噩夢,因為你的 YouTube 帳號與更廣泛的 Google 帳號關聯,而 Google 又是人工智慧領域最大的公司之一, YouTube 的人工智慧影片摘要就是明證。要涵蓋 Google 利用你的資料(甚至在你的 Google 帳號之外)訓練人工智慧的所有方式以及如何阻止它,需要一篇篇幅更長的指出。但即使在 YouTube 這個小範圍內,Google 似乎也會在未經頻道所有者(YouTuber)知情或同意的情況下,利用上傳到 YouTube 的影片來訓練影片產生模型。

如何阻止這種情況?如果您是 YouTube 的普通用戶,您可以嘗試在 Google 帳戶層面上盡可能地選擇退出 Google 的 AI 訓練。但如果您上傳影片到 YouTube,情況就完全不同了。目前,Google 沒有任何選項可以阻止其 AI 模型使用您的影片進行訓練。

然而,諷刺的是,Google確實提供了選擇退出第三方模型使用您資料的選項。要做到這一點,請打開 YouTube 創作工作室,依次點擊“設定”>“頻道”>“高級設定”,然後向下捲動至“第三方訓練”。在那裡,您可以取消勾選「允許第三方公司使用我的頻道內容訓練 AI 模型」。

評論被關閉。