語言、現實、LLM
把想法組織成語言的過程如此漫長,多半時候,我只是盯著閃爍的游標。目前我能想到最貼切的比喻是: 寫作的過程近似於把高維度空間裡的概念網路,嵌入到線性語言的空間裡。這項工作的困難之處在於,要盡可能地保留概念之間細微的連結,讓其他人能以線性的語言重新理解。
幾乎可以肯定的是,每個人的概念網路都是不同的,加上語言必須依序展開,又受到篇幅的限制,導致各個概念之間很多細微的連結難以展現。即使如此,我們多數時候都還是能理解彼此。這件事本身非常奇怪。如果要讓一切顯得不那麼神祕,一個可能的解釋是: 我們都在回應一個共享的現實。只是各自的解讀難免有差距。如果我們回應的不是一個共享的現實,那麼所有個體的思想在經過各種轉換以後,為何還能以語言的方式被相互理解,還能在歷史的長河中維持足以辨認的連續性呢?
然後我突然意識到,這個道理之所以讓我感覺這麼神奇,是因為我直覺上把「現實」想成由概念及其關聯組成地網絡,而人類只能從不同角度感知它。唯物主義者可能完全不認為這有什麼好大驚小怪的。他們會說「現實」就是人類所共享的物質世界,而人類又擁有相似的身體、認知結構與歷史經驗,因此我們能理解彼此也是理所當然。
我不知道哪種看法是對的,或有沒有單一的正解。但無論從哪個角度,語言都只能提供某種經過選擇和組織的表徵。假如能不考慮篇幅、時間的限制,廣義的語言——包括數學語言——能否完整表達現實的一切面向,則又是另一個問題。
我目前傾向認為不行,因為概念經過人類感知與理解,再轉換成語言的過程中,難免有遺漏。即使語言能窮盡人的思想,人的思想仍未必能窮盡「現實」。然而,從某些物理主義的角度,情況有可能不同。他們會說一旦物質世界能被完整指定,人類如何理解、連結現實中的概念並不提供獨立於物理事實之外的資訊。但即便如此,也無法保證語言能夠完整表達物質世界的資訊。
這也解釋了為什麼我直覺上不相信僅靠文字訓練的語言模型能掌握現實。它接觸的是經過人類轉譯、投射到語言中的部分世界。即使它能夠從大量投影中重建部分的現實,我們仍不知道,一個包含局部資訊的模型,能否理解或推論剩餘未進入人類語言的現實。
喜欢我的作品吗?别忘了给予支持与赞赏,让我知道在创作的路上有你陪伴,一起延续这份热忱!
