ChatGPT 對谷歌搜尋資料的隱藏使用被揭露

OpenAI 繼續尋求與Google搜尋競爭,它在幕後做了一些意想不到的事情:依靠谷歌自己的搜尋結果進行訓練和運行

揭秘 ChatGPT 對 Google 搜尋資料的隱藏使用:Tom's Guide 的綜合指南

根據The Information報道,OpenAI 使用來自Google搜尋的數據,並透過位於德克薩斯州奧斯汀的 Web 數據聚合服務 SerpApi 進行處理。據稱,這些數據幫助 ChatGPT 回答有關新聞、體育和金融市場的即時查詢——在這些領域,OpenAI 的內部工具仍然難以應對。

Google 搜尋與 ChatGPT 之間的競爭

在 Google 前的手機上使用 ChatGPT

尤其令人驚訝的是谷歌過去的立場。根據OpenAI與美國司法部正在進行的反壟斷訴訟中披露的文件顯示,去年,Google拒絕了OpenAI存取其搜尋索引以提升ChatGPT效能的直接請求。但如今,OpenAI卻從Google雲端租用伺服器來運行ChatGPT——這清楚地表明,商業實用主義可以克服競爭壓力。

SerpApi 的客戶名單並不限於 OpenAI。據報道, Meta、蘋果和Perplexity (ChatGPT 搜尋的競爭對手)等其他科技巨頭也是其客戶。 SerpApi 甚至在其網站上公開列出了 OpenAI 。

儘管有這種摩擦,Google尚未採取法律行動關閉SerpApi。這可能是由於監管壓力;司法部的訴訟可能會迫使谷歌向競爭對手開放其搜尋索引。

你用過嗎? ChatGPT 真正搜尋結果 Google؟

OpenAI

一些外部開發者也提出了類似的說法。一位名叫Abhishek Iyer 的前Google工程師創建了一些虛假網頁,這些網頁僅出現在Google索引中。當ChatGPT隨後查詢這些網頁時,機器人給出的回應資訊就來自這些特定網頁,這表明ChatGPT 的回應確實重複使用了Google搜尋結果片段。

這一點至關重要,因為Google搜尋結果頂部顯示的簡潔答案(即Google摘要)是使用專有方法產生的。雖然OpenAI擁有自己的網路爬蟲並且可以存取微軟的 Bing 搜尋 API ,但這似乎不足以大規模複製Google的準確率,尤其是在處理晦澀或詳細的搜尋查詢時。

今年早些時候,OpenAI 的 Nick Turley在法庭作證時承認了這一點。 Turley 表示:“我們的目標——一個遠大的目標,而且我們離目標還很遠——是讓大約 80% 的流量來自我們自己的索引。我們相信從長遠來看,100% 是可以實現的,但是……這在實踐中是不可行的。”

底線

儘管ChatGPT的發展勢頭迅猛——每週用戶量達 700 億,預計年收入將達到 10 億美元——但與谷歌的規模相比仍然相形見絀。谷歌每年處理超過5 兆次搜索,並且仍在持續強勁增長。

即使相較之下,OpenAI 的計劃也更加宏大。除了訂閱模式,該公司還在探索廣告(類似 Perplexity)和聯盟行銷合作,旨在將免費用戶轉化為收入來源,就像Google Shopping 的搜尋結果一樣。

谷歌是否會真正將產品或購物資料授權給 OpenAI 仍有待觀察。但隨著 OpenAI 試圖利用Google自己的工具主導搜尋市場,爭奪搜尋未來之戰正在迅速升溫。

評論被關閉。