AI 基礎與工具

[AI 使用說明 #1] ChatGPT 不是搜尋引擎:AI 產生回答的原理

向 ChatGPT 提問並收到回答時,很容易以為它只是找到儲存在某處的正確答案並顯示給你,就像在 Naver 或 Google 輸入關鍵字後找到文件一樣。但 AI 並不是這樣運作的。正因為這個誤解,才會出現「AI 說謊了」、「AI 的說法前後不一」等令人困惑的經驗……

閱讀 4 分鐘
[AI 使用說明 #1] ChatGPT 不是搜尋引擎:AI 產生回答的原理 封面圖

向 ChatGPT 提問並收到回答時,很容易以為它只是找到儲存在某處的正確答案並顯示給你,就像在 Naver 或 Google 輸入關鍵字後找到文件一樣。但 AI 並不是這樣運作的。正因為這個誤解,才會出現「AI 說謊了」、「AI 的說法前後不一」等令人困惑的經驗。本系列第一篇,先釐清這個誤解。

搜尋引擎負責尋找,AI 負責生成

搜尋引擎和 AI 的差異,就像圖書館員與說書人的差異。

搜尋引擎是圖書館員。你問「濟州島美食」,它就從書架找出相關文件,原樣交給你。不論文件寫了什麼,它都不會更改內容,也不會捏造不存在的文件。現在搜尋結果最上方常會出現 AI 摘要,但那部分是說書人寫的,不是圖書館員。只要記住這個區別。

ChatGPT 這類 AI 比較接近說書人。收到問題後,它不是從某處找來文件,而是**當場重新產生句子。**你收到的回答,是世上原本沒有儲存過的文字,剛才才在現場生成。因此,這類 AI 被稱為生成式 AI。

那麼,它是根據什麼來生成的?關鍵原理就在這裡。

原理只有一個:預測下一個詞

ChatGPT 的根基是一項稱為 LLM(Large Language Model,大型語言模型)的技術。名稱聽起來很厲害,但它只做一件事:預測能自然接在目前文字後面的下一個詞。

可以想像手機鍵盤的自動完成。輸入到「今天天氣」時,鍵盤可能會推薦「很好」。LLM 將這種自動完成擴展到超乎想像的規模。它閱讀網路書籍、文章與網頁文件中的數兆個詞,學習「這種文字後面會接這種說法」的模式,因此不只能接續一兩個詞,還能整篇寫完一份報告。

所以 AI 產生回答的過程是這樣:收到你的問題,選出最可能接在後面的詞,再把這個詞納入文字中,繼續選下一個詞。每秒重複數十次,完成句子。

LLM 重複預測下一個詞,從候選機率中選擇並完成句子的循環流程圖
每秒重複數十次選出一個下一個詞,就是回答的全部過程

「看似合理的話」為什麼會顯得聰明?

你可能會疑惑:「全部只是預測下一個詞?那為什麼還能翻譯和摘要?」

秘密在於規模。要準確預測下一個詞,終究需要世界知識。要接出「朝鮮王朝的第 4 位國王是」後面的詞,就得知道歷史;要續寫「這段程式碼的錯誤是」,就得懂程式設計。在學習大量文字的過程中,知識與推理模式被壓縮進模型裡。

不過,它的儲存方式和搜尋引擎不同。文件不是整份保存,而是以模式融入數千億個數字(參數)之中。這和人的記憶很像。我們也無法逐字取出去年讀過的書,但仍能談論內容。因此,AI 的知識更接近「大概是這樣」而不是精確引用原文。

同一個問題每次得到不同回答的原因

AI 選擇下一個詞時,不會只選機率最高的候選。它會在高機率候選中加入些微隨機性來選擇。若每次都只選第一名,回答會變得機械又 predictable,因此系統會刻意加入變化。

所以同一個問題問兩次,可能得到不同答案。這不是故障,而是設計如此。把它當成搜尋引擎,就會問「為什麼答案變了?」;把它當成句子生成器,就很自然了。

這項特性會依使用方式成為優點。如果不喜歡回答,可以重新生成另一個版本;需要像腦力激盪一樣的多種方案時,尤其有用。

搜尋引擎與生成式 AI 處理流程比較圖:文件搜尋與下一個詞的預測生成
搜尋引擎負責找出內容,生成式 AI 負責創造內容,兩者從起點就不同

為什麼不該詢問最新新聞,以及例外情況

LLM 的知識會停在完成訓練的時間點。這個時間點稱為知識截止(knowledge cutoff,知識截止時間)。訓練結束後世界發生的事不在模型裡。昨天的新聞、今天的匯率、本週上映的電影,原理上都無法得知。

不過,現在的服務會用網路搜尋功能補足這項限制。遇到需要最新資訊的問題時,AI 會先搜尋,再根據找到的文件產生回答,就像從圖書館員手中取得資料的說書人。雖然很多服務會自動搜尋,但詢問最新資訊時,最好確認回答是否真的附上來源連結。若想更確定,可以補充「請到網路上搜尋後告訴我」。這種用法會在第 4 篇詳細介紹。

總結

  • AI 不是尋找儲存的正確答案,而是在當下產生句子
  • 原理是預測下一個詞,而大量訓練讓這項預測像知識一樣運作
  • 同一個問題得到不同答案不是故障,而是設計如此
  • 知識會停在訓練時間點,最新資訊則透過網路搜尋功能補足

但這項原理也有陰暗面。如果 AI 的目標不是「說出正確答案」,而是「產生看似合理的句子」,就代表它也能任意產生看似合理卻錯誤的內容。事實上它真的會,而且非常有自信。下一篇將介紹如何辨識並應對 AI 捏造的謊言,也就是幻覺。

延伸閱讀