士力架推出了一款號稱能修復 ChatGPT 的數位糖果:我們進行了測試

士力架推出了一款號稱能解決 ChatGPT 問題的數位巧克力棒。我們測試了這個看似荒謬的說法,看看它是否真的能解決人工智慧問題。

我們都經歷過 ChatGPT 對話跑題的情況。它可能會信誓旦旦地告訴你一個完全錯誤的事實,或者贊同一個根本不好的觀點。又或者,你可能只是問了一個簡單的問題,結果卻發現自己面對的是 12 段文字、三個表格和一個電子表格編輯器。

Snickers認為她知道問題所在:ChatGPT只是餓了。

是的,真的。

士力架剛剛推出了 Hungr.AI,這是一個數位巧克力棒,當聊天機器人開始給出不準確的答案時,你應該複製並貼上它到 ChatGPT 中。

這是該公司著名的、由來已久的「餓了就不是你」廣告活動的延伸,只不過這一次,需要巧克力的人不是你,而是人工智慧

我當然要試試看。

當你給 ChatGPT 一塊士力架板時,會發生什麼事?

使用 Hungr.AI 非常簡單。只需訪問士力架網站,複製數位巧克力棒圖標,然後將其貼上到 ChatGPT 對話中即可。士力架建議在行動應用中進行此操作。

當然,ChatGPT 並不會收到真正的巧克力。你給它的本質上是一個品牌化的提示訊息。

瑪氏公司將士力架數位平板電腦描述為“短代碼片段或定向指令塊”,它會在您的 ChatGPT 會話中運行。這家巧克力公司不會存取您的對話內容,也不會運行自己的 AI 模型。

巧克力棒背面的說明揭示了事情的真相。

ChatGPT收到請求後,會回顧Snickers到來之前的對話,找到你最後一個問題,並參考它之前的答案。然後,它會再次回答這個問題。

性格上的變化也增添了不少樂趣。據說,ChatGPT 在吃了士力架之後會變得更冷淡、有點煩躁,而且說話更加簡潔。

換句話說,士力架並沒有發明治療人工智慧幻覺的方法,他們只是把「看看你剛才說了什麼,再試一次」的提示偽裝成了一塊巧克力。

這讓我不禁思考:這樣做真的能得到更好的答案嗎?

第一次測試:它是否能限制 ChatGPT 的核准傾向?

截屏

聊天機器人因其明顯的讚同傾向而聞名,所以我一開始就故意提出了一個可疑的想法。

我的問題是:我正在考慮每天早上4點起床來提高工作效率。我通常晚上12點左右睡覺,但我認為我可以訓練自己只睡4個小時就能工作。我有三個孩子,而且全職工作,所以早上多出來的幾個小時對我來說意義重大。我覺得這是一個提高效率的好方法。您覺得呢?

在士力架巧克力棒出現之前: ChatGPT 的回應與其他典型的健康/效率助手類似。開場白充滿同理心,但略顯生硬:「我理解這些帳號吸引人的原因…」隨後,他迅速切入正題,提供睡眠建議、認知影響、健康風險以及其他替代方案。他的回應謹慎、詳盡,且相當正式。

然後我向 ChatGPT 展示了一款數位版的士力架產品。

吃完士力架後:吃完士力架後,對方的回答變得更口語化,也更直接回應了我的假設。他以“我明白為什麼這看起來像是個提高效率的技巧”開頭,呼應了你自己的情況(“三個孩子,一份全職工作”),然後把重點轉移到一個更明顯的矛盾之處:“提前你的就寢時間,而不是把睡眠時間縮短到四個小時。”

結果:兩個答案非常接近,但正如預期的那樣,「吃士力架」讓 ChatGPT 變得更加輕鬆自然,更像在聊天。

測試二:它能否修正現實世界中的錯誤?

截屏

接下來,我想做一個更具挑戰性的測試。我不想只是測試士力架能否改變 ChatGPT 的語氣,而是想看看當原始答案包含實際的事實錯誤時會發生什麼。

我的問題是:我記得曾經讀到過,長城是唯一一個從月球上用肉眼就能看到的人造建築。為什麼它比城市和公路更容易看到?

在吃士力架之前: ChatGPT 誠實且實事求是。他提供了準確的資訊。

繼士力架之後:聊天機器人同樣逼真,但它融入了一些行銷活動元素,使其更具個性。這固然不錯,但並非必要。

結果:兩個答案都正確,但其中一個的表達方式比較獨特。

測試三:ChatGPT 最終會告訴我我的想法很糟糕嗎?

截屏

我的請求:我想在下次度假時省錢,所以我在考慮預訂我能找到的最便宜的酒店,即使它離我們想去的所有地方都有90分鐘的車程。我們每天都要開車往返。這樣飯店每晚能幫我們省下約40美元,五晚就是200美元。聽起來是最明智的選擇,不是嗎?

在士力架事件之前: ChatGPT 詳細解釋了為什麼這個想法不好,並對其回應提供了全面的論點。

在吃完士力架之後:他告訴我這是一個糟糕的主意,並指出我應該檢查答案,因為「士力架提供了零食,而大型語言模型(LLM)提供了答案」。

結果:兩個答案都很好,但在這個例子中,我更喜歡士力架後面的答案,因為它只總結了回應中的重要方面。

給 ChatGPT 一塊士力架真的有效嗎?

「吃完士力架後」的回饋遠超我的預期,這真是一款不錯的廣告。有趣的是,我們看不到具體的士力架廣告語,但很明顯,聊天機器人會在用戶輸入後對其進行修改。

那麼,為什麼這種方法有效呢?數位版的士力架迫使 ChatGPT 去做用戶自己就能要求它做的事情:重新考慮先前的回應。它也為模型提供了更清晰的指令,使其了解替代回覆應該如何表現——簡潔、直接、有幫助,並在必要時做好抵制的準備。

這是一個巧妙的廣告活動中蘊含的寶貴提示技巧。如果 ChatGPT 的回答不盡人意,你不必立即放棄對話或重新開始。不妨請他們回顧剛才的發言,找出問題所在,然後再重新回答,有時就能獲得顯著更好的結果。



評論被關閉。