在 2022 年之前,如果你想在沒有作品本身的情況下快速回憶起你最喜歡的書中的特定段落或你剛剛看過的電影中的台詞,你可能會轉向搜尋引擎。您可以使用格式良好的搜尋輸入來提示它,解析返回的結果,訪問似乎包含您的答案的 SparkNotes 或 IMDB 鏈接,並在幾分鐘內在頁面上找到您要查找的文本。現在,您只需打開 ChatGPT,輸入“最著名的《終結者》名言是什麼?”或「寫出《兩個城市的故事》的開頭段落」並在幾秒鐘內得到你的逐字回答。 大型語言模型 (LLM) 最簡單的用途之一是作為知識資料庫。法學碩士接受過包含豐富資訊的大量資料集的培訓,像 ChatGPT 這樣的介面使得檢索變得容易。例如,當您提示 ChatGPT 返回電影或書籍中的內容時,您只是利用模型的能力來回憶其在訓練期間接觸到的信息。但是,如果它沒有接受《魔鬼終結者》劇本的訓練,或者它的權重不重視狄更斯的作品,該怎麼辦?為了即使是最簡單的用例(例如基本資訊檢索)也能提供最準確和相關的結果,LLM需要複雜的索引和檢索機制,能夠精確地存取廣泛的資訊。了解LLM內容生成與培訓*LLM 內容是透過稱為「下一個令牌預測」*的過程產...