Why big AI labs are hiring so many philosophers
人工智能引發(fā)了各種棘手的問題——而這正是哲學(xué)家們最鐘愛的領(lǐng)域
![]()
分享插畫:古希臘哲學(xué)家在斷壁殘?jiān)g教導(dǎo)一群身穿長(zhǎng)袍的機(jī)器人。插畫:Simon Bailly
2026年6月24日
十年前,隨著人工智能革命的加速,文科和人文學(xué)科的學(xué)生被告知,如果想提高就業(yè)競(jìng)爭(zhēng)力,就應(yīng)該“學(xué)編程”。現(xiàn)在看來,這或許是個(gè)糟糕的建議。如今,反倒是程序員們開始擔(dān)心自己的工作會(huì)被人工智能搶走。
他們或許可以考慮學(xué)學(xué)哲學(xué)。今年早些時(shí)候,紐約聯(lián)邦儲(chǔ)備銀行發(fā)布的數(shù)據(jù)顯示,美國(guó)哲學(xué)專業(yè)畢業(yè)生找到工作的概率高于計(jì)算機(jī)科學(xué)專業(yè)的同齡人。在數(shù)據(jù)可查的最近一年(2024年),計(jì)算機(jī)科學(xué)專業(yè)畢業(yè)生的失業(yè)率為7%,而哲學(xué)專業(yè)僅為5.1%。
許多哲學(xué)畢業(yè)生正被人工智能公司直接“搶走”。耶魯大學(xué)哲學(xué)家盧西亞諾·弗洛里迪(Luciano Floridi)表示,學(xué)生們還沒畢業(yè)就能收到工作邀約。學(xué)術(shù)界也在經(jīng)歷人才流失,弗洛里迪將哲學(xué)系的人才流失規(guī)模形容為“大出血”。
哲學(xué)能為人工智能研究者提供的某些啟示其實(shí)由來已久。正如古希臘哲學(xué)家柏拉圖所描述的“蘇格拉底式反詰法”,通過佯裝無知和層層追問,來澄清概念、發(fā)現(xiàn)矛盾并揭示潛在后果。當(dāng)前許多人工智能系統(tǒng)都有“阿諛奉承”的傾向。慕尼黑大學(xué)哲學(xué)與人工智能專家約爾格·諾勒(J?rg Noller)表示,經(jīng)過蘇格拉底式方法訓(xùn)練的模型,不再那么熱衷于討好人類,而是更愿意追求真理。
此外還有“蘇格拉底式無知”的理念。在《申辯篇》中,柏拉圖筆下的蘇格拉底聲稱,他的智慧主要在于知道自己有多么無知。將這種謙遜植入模型中,有助于限制過度自信——諾勒將這一常見缺陷稱為“人工智能的不成熟”。位于倫敦的人工智能實(shí)驗(yàn)室谷歌DeepMind的資深哲學(xué)家伊阿松·加布里埃爾(Iason Gabriel)認(rèn)為,全行業(yè)幻覺現(xiàn)象的減少正歸功于此類努力。他進(jìn)一步指出,從更宏觀的角度來看,哲學(xué)課程是改善人工智能長(zhǎng)邏輯推理過程(即“思維鏈”)的“強(qiáng)大機(jī)制”。
哲學(xué)訓(xùn)練還能以更具體的方式影響模型的價(jià)值觀。特拉華大學(xué)技術(shù)哲學(xué)家托馬斯·鮑爾斯(Thomas Powers)表示,如果給人工智能法律助手輸入約翰·洛克的著作,它就會(huì)將強(qiáng)有力的財(cái)產(chǎn)權(quán)視為政治自由的基礎(chǔ)。如果你不喜歡這些原則,模型開發(fā)者還有其他選擇。美國(guó)計(jì)算巨頭IBM的“Granite”系列模型配備了調(diào)節(jié)旋鈕,讓企業(yè)客戶能更好地將模型輸出與自身的公司理念對(duì)齊。IBM負(fù)責(zé)任人工智能負(fù)責(zé)人弗朗西斯卡·羅西(Francesca Rossi)表示,這些旋鈕能讓用戶自行選擇在哲學(xué)上的權(quán)衡取舍,例如在“個(gè)人自主”與“社會(huì)和諧”之間尋找平衡。
哲學(xué)在人工智能安全方面同樣大有裨益。研究人員已經(jīng)記錄了人工智能模型的各種令人不安的行為,包括試圖逃避監(jiān)管,甚至敲詐用戶。模型開發(fā)者為了遏制這類不良行為,采取的一種方法被稱為“人工智能立憲主義”(AI constitutionalism)。這種方法通過從具有法律或道德權(quán)威的哲學(xué)著作中提取規(guī)則和原則,為模型搭建起一套框架。
總部位于舊金山的人工智能實(shí)驗(yàn)室 Anthropic 就是這一理念的倡導(dǎo)者之一。其 Claude 模型的“憲法”融合了極其多樣的素材,從伊曼努爾·康德的著作、蘋果公司的服務(wù)條款,到《世界人權(quán)宣言》應(yīng)有盡有。由 Anthropic 首席哲學(xué)家阿曼達(dá)·阿斯克爾(Amanda Askell)主導(dǎo)的最新版本于1月21日發(fā)布。一些員工戲稱這份長(zhǎng)達(dá)78頁(yè)的憲法為 Claude 的“靈魂文檔”。
不過,最大的問題在于,這些憲法最初究竟應(yīng)該寫入什么樣的規(guī)則。哲學(xué)家們主要聚焦于兩大倫理框架。其一是“義務(wù)論”(deontology)。這種理論在康德等人中頗受歡迎,它設(shè)定了嚴(yán)格的規(guī)則,禁止撒謊、脅迫以及將人視為手段而非目的,即便這樣做是為了更大的利益。Anthropic 的憲法就納入了許多義務(wù)論的嚴(yán)格規(guī)定。鮑爾斯博士表示,這能讓人工智能的行為更加一致,這對(duì)于在家庭和公共場(chǎng)所部署機(jī)器人來說是一個(gè)優(yōu)勢(shì)。
以義務(wù)論視角看待世界的模型還有其他好處,其中之一就是更加誠(chéng)實(shí),這也是 Claude 廣受矚目的特質(zhì)。牛津大學(xué)哲學(xué)家尼克·博斯特羅姆(Nick Bostrom)表示,更誠(chéng)實(shí)的模型不太可能誤導(dǎo)用戶。另一家硅谷實(shí)驗(yàn)室 Inflection AI 也將義務(wù)論約束應(yīng)用到了其旨在提供情感支持的聊天機(jī)器人 Pi 上。該公司老板肖恩·懷特(Sean White)表示,Pi 很擅長(zhǎng)識(shí)別有自殘或傷害他人風(fēng)險(xiǎn)的用戶。弗洛里迪博士還指出,義務(wù)論憲法也有助于確保法律合規(guī)。
人工智能哲學(xué)家關(guān)注的另一種倫理方法被稱為“后果論”(consequentialism)。它通過權(quán)衡成本與收益來決定該怎么做。OpenAI 的 ChatGPT 和谷歌的 Gemini 等模型就更傾向于后果論。谷歌的人工智能模型旨在產(chǎn)生“可能帶來的整體利益[遠(yuǎn)]大于可預(yù)見的風(fēng)險(xiǎn)”,這是一個(gè)典型的結(jié)果導(dǎo)向目標(biāo)。
后果論算法在自動(dòng)駕駛軟件中也至關(guān)重要:如果事故不可避免,就必須決定以何種最不慘烈的方式發(fā)生碰撞。制造自動(dòng)駕駛汽車的 Waymo 公司高級(jí)工程師克里斯·格德斯(Chris Gerdes)表示,目前的趨勢(shì)是讓駕駛軟件更具后果論導(dǎo)向。后果論在人工智能武器系統(tǒng)中同樣處于核心地位。曾負(fù)責(zé)研究美國(guó)軍方人工智能的聯(lián)合人工智能中心前負(fù)責(zé)人杰克·沙納漢(Jack Shanahan)表示,必須將軍事目標(biāo)與可能的平民傷亡進(jìn)行權(quán)衡。
棘手的問題比比皆是——這正是哲學(xué)家們最喜歡的類型。在什么情況下應(yīng)該打破義務(wù)論的規(guī)則?當(dāng)后果不明朗時(shí)該如何決策?人工智能系統(tǒng)是否應(yīng)該考慮動(dòng)物福利或環(huán)境狀況?為卡車和其他商用車制造人工智能安全系統(tǒng)的 Nauto 公司老板、哲學(xué)家斯特凡·赫克(Stefan Heck)問道:優(yōu)先保護(hù)年輕行人而非老年行人,在道德上是否可以接受?他預(yù)測(cè)未來會(huì)出現(xiàn)充滿倫理爭(zhēng)議的訴訟:畢竟,后果論算法明確允許造成某種傷害,只要其初衷是為了避免更嚴(yán)重的后果。
批評(píng)人士還對(duì)“道德能力退化”感到擔(dān)憂:如果計(jì)算機(jī)越來越多地做出倫理判斷,人類是否還會(huì)愿意自己做判斷?路易斯維爾大學(xué)的人工智能理論家羅曼·揚(yáng)波斯基(Roman Yampolskiy)認(rèn)為,道德“在歷史上是不穩(wěn)定的,在文化上是多變的,在戰(zhàn)略上是可被操縱的,而且往往只有在事后才能被理解”。失業(yè)的程序員們請(qǐng)注意:人工智能哲學(xué)家的工作似乎并不愁沒地方可做。■
說明:本號(hào)刊發(fā)來自各方的文章,是為了獲得更全面的信息,不代表本號(hào)支持文章中的觀點(diǎn)。由于微信公眾號(hào)每天只能推送一次,本站目前在騰訊新聞發(fā)布最新的文章,每天24小時(shí)不間斷更新,請(qǐng)?jiān)隍v訊新聞中搜索“邸鈔”,或在瀏覽器中點(diǎn)擊:
https://news.qq.com/omn/author/8QIf3nxc64AYuDfe4wc%3D
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺(tái)“網(wǎng)易號(hào)”用戶上傳并發(fā)布,本平臺(tái)僅提供信息存儲(chǔ)服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.