文/陳根
最近張文宏拒絕AI進入醫(yī)療,引發(fā)了很大的關(guān)注,也引發(fā)了一些爭論。我想從專業(yè)的角度來跟大家探討關(guān)于AI到底能不能值得完全信任,這背后就涉及到一個非常核心的問題,也就是大模型當前一種被困擾的關(guān)鍵問題,不是算力,也不是算法,也不是數(shù)據(jù),而是AI幻覺的問題,這是可以說是AI一個無法真正解決的問題。
AI幻覺的頑疾與本質(zhì)
在人工智能(AI)迅猛發(fā)展的時代,幻覺(Hallucination)已成為大型語言模型(LLM)如ChatGPT、Claude和Gemini的普遍問題。當然,中文大模型我們就不談了,基本上只能由于娛樂,還談不上可靠度的層面。
AI幻覺是指AI生成看似合理卻實際錯誤、虛構(gòu)或誤導的內(nèi)容。這種現(xiàn)象并非技術(shù)故障,而是AI體系的結(jié)構(gòu)性缺陷。或者說是AI的“原罪”導致的,因為從一開始AI的數(shù)據(jù)就來源于人類的知識庫,而人類的知識庫就充滿著大量的謊言與胡說八道。
![]()
盡管研究人員一直在嘗試通過檢索增強生成(RAG)、微調(diào)和事實檢查等方法緩解,但幻覺始終揮之不去。2025年的一項OpenAI研究指出,幻覺源于訓練和評估過程對猜測的獎勵,而非不確定性的承認。其實核心并不是這些問題,而是在于AI的最底層邏輯,也就是兩個核心問題所導致,這也是我重點跟大家探討的問題。以及為什么我一直說,AI幻覺問題是無法真正解決的原因。
首先,人類知識數(shù)據(jù)本身充斥幻覺,導致AI繼承并放大這些缺陷;其次,AI的自我生成內(nèi)容機制形成惡性循環(huán),進一步污染訓練數(shù)據(jù)。這些因素就導致,AI幻覺不是可完全根除的“bug”,而是AI認知范式的內(nèi)在局限,類似于人類認知的“不可知論”困境。
人類知識數(shù)據(jù)的固有幻覺——AI的“原罪”繼承
AI幻覺的根源在于其訓練數(shù)據(jù):這些數(shù)據(jù)本質(zhì)上是人類知識的鏡像,而人類知識遠非完美,也并非準確無誤,除了已經(jīng)被驗證的一些數(shù)學與物理的公式,定律之外,大部分的知識都不是真理,也不是無誤的。
LLM通過海量文本學習模式,但這些文本充斥錯誤、偏見和不確定性,導致AI無法區(qū)分“真實”與“似真”。正如MIT Sloan的一項分析所描述的,生成AI的幻覺源于訓練數(shù)據(jù)的固有缺陷,包括虛假信息和偏見。而我們?nèi)祟愔R的“幻覺”體現(xiàn)在幾個層面:
首先,數(shù)據(jù)的不完整性和低頻事實問題。OpenAI的研究強調(diào),LLM在預訓練中預測下一個詞,但低頻或任意事實(如寵物生日)無法從模式中可靠推斷,只能通過猜測填充。 這類似于人類記憶的“填補空白”機制:大腦基于模式回憶,但容易出錯,甚至很多回憶是伴隨著幻覺的。
IBM的分析進一步指出,如果訓練數(shù)據(jù)集偏倚或不是絕對正確的代表性,AI會“幻覺”出反映這些偏見的模式。最典型的就是,歷史文本中性別或種族偏見,以及歷史的虛假敘事會被AI繼承,導致輸出中出現(xiàn)虛構(gòu)的“事實”。
其次,人類知識的固有不確定性。聯(lián)合國大學的一項評論指出,AI幻覺不是“精神錯亂”,而是預測錯誤,源于訓練數(shù)據(jù)的局限和缺乏真實理解。這是因為我們?nèi)祟愔R本身就是構(gòu)建的,比如科學理論更迭(如從地心說到日心說),歷史敘事主觀(如不同文化對事件的解讀)。
而對于AI而言,其擁有的能力就是類似于人類的表達方式,具備的是優(yōu)先流暢性而非真相,當數(shù)據(jù)有矛盾時,它會生成“統(tǒng)計上合理”的虛構(gòu)。即使訓練于“準確”數(shù)據(jù),AI的生成本質(zhì)仍可能組合出新錯誤,因為它缺乏“世界模型”——人類般的語境理解。
第三,數(shù)據(jù)質(zhì)量的系統(tǒng)性問題。AI訓練,或者獲取的文本數(shù)據(jù),本身就容易受人類錯誤影響,尤其是一些用于分析的結(jié)構(gòu)化數(shù)據(jù)更容易出錯。Berkeley的一項研究指出,訓練數(shù)據(jù)的偏見、過度擬合和合成數(shù)據(jù)污染進一步放大幻覺。這些問題就構(gòu)成了我前面所提到的,AI的“原罪”。即,AI從人類“幻覺”中誕生,無法超越其源頭。即使清理數(shù)據(jù),人類知識的動態(tài)性和主觀性(如文化神話、政治宣傳)使“純凈”數(shù)據(jù)集成為烏托邦。
![]()
OpenAI也承認,幻覺在基礎(chǔ)模型中,在數(shù)學上不可避免,除非徹底重構(gòu)訓練范式。其實重構(gòu)訓練范式也不能徹底解決AI幻覺的問題,因為我們依然無法回避一個最底層的問題,就是人類的知識庫本身的非真理性問題。因此,這一方面揭示AI幻覺的哲學根基:它鏡像人類認知的有限性,無法實現(xiàn)柏拉圖式“理想形式”的絕對真理。
AI自我生成數(shù)據(jù)循環(huán)——惡性反饋的放大器
AI幻覺的第二個頑固原因在于其自我生成機制:模型輸出內(nèi)容被用于后續(xù)訓練,形成“AI-on-AI”反饋循環(huán),進一步注入幻覺。
Harvard的一項框架分析指出,這種循環(huán)導致生成的不準確污染未來數(shù)據(jù),引發(fā)“模型崩潰”。這類似于生態(tài)系統(tǒng)的退化,即污染源自內(nèi)部,難以逆轉(zhuǎn)。如果用人類來形容的話,就是精神病患者訓練精神病患者,最終可能會導致最初的精神病患者崩潰。
首先,生成內(nèi)容的固有不確定性。由于LLM基于統(tǒng)計模式生成,而非事實檢索,導致輸出雖連貫卻易虛構(gòu)。當這些輸出回流訓練(如通過網(wǎng)絡(luò)爬取),幻覺就會被強化。《紐約時報》的一篇互動報道顯示,AI生成數(shù)據(jù)越來越難檢測,導致未來模型攝入自身輸出,輸出范圍縮小,遠離現(xiàn)實。這種現(xiàn)象,如果用一個比喻來說,就是“自食循環(huán)”。尤其是,如今60%網(wǎng)絡(luò)內(nèi)容由AI生成,訓練數(shù)據(jù)已經(jīng)變得非常不可靠。
其次,暴露偏見和漂移效應(yīng)。如果我們在訓練時使用“ground truth”數(shù)據(jù),但推理時依賴自身生成,這就會導致早期的錯誤在循環(huán)中不斷被放大。Nature的一項2024年研究證實,遞歸生成數(shù)據(jù)訓練會導致模型崩潰。
并且會很快出現(xiàn)多樣性喪失,輸出趨于單一。這形成惡性循環(huán),帶來的后果就是幻覺生成更多幻覺數(shù)據(jù),用于下一代模型。然后在循環(huán)中,數(shù)據(jù)模糊和隨機解碼又會加劇這一問題。
第三,循環(huán)的系統(tǒng)性風險。即使使用RAG或知識圖譜,數(shù)據(jù)污染仍不可避免,因為網(wǎng)絡(luò)已經(jīng)充斥AI內(nèi)容。這從哲學上類似于尼采的“永恒輪回”:AI陷入自我復制的循環(huán),無法逃脫內(nèi)在缺陷。人類干預(如人工標注)雖然可以起到緩解,但規(guī)模化訓練依賴海量數(shù)據(jù),難以徹底凈化。
因此,我可以非常明確的說,AI幻覺無法真正解決,因為它根植于人類知識的固有局限和AI生成-訓練的閉環(huán)邏輯。前者是“輸入垃圾,輸出垃圾”的放大;后者是自我污染的反饋陷阱。
即使技術(shù)進步,如自信度間隔或非幻覺模型,幻覺仍如人類認知的“海森堡不確定性”——本質(zhì)上不可消除。從這個層面來看,我們就能回答張文宏所提到的這個觀點,或許一些人認為AI已經(jīng)很強大了,張文宏不引入AI是不是落伍了?其實并不是,而是他對AI有比較深刻的了解,至少說明他認知到了AI強大背后的本質(zhì)問題,也就是AI幻覺不可能被徹底解決。
所以,對于臨床的醫(yī)生而言,尤其是醫(yī)學院的學生,如果不能對病理機制有非常深刻的理解,而是過早的依賴于AI來輔助診斷的話,最終可能會陷入一種被AI誤導的循環(huán)中。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.