商業與金融

楊立昆出走Meta,在巴黎打造「世界模型」挑戰大型語言模型

Penelope H. Fritz
在 Google 中新增我們
楊立昆
楊立昆
Photo: Ecole polytechnique from Paris / CC BY-SA 2.0, via Wikimedia Commons
出生1959年7月8日
Paris
職業電腦科學家、人工智慧企業家
獲獎PAMI傑出研究員獎 · 哈羅德·彭德獎 · 圖靈獎

多年來,楊·勒昆(Yann LeCun)一直身處一家競相打造愈來愈大型聊天機器人的公司,卻不斷告訴所有願意聽的人,這條路永遠無法通往人類級智慧。如今他離開了公司,要用略高於十億美元的他人資金證明自己所言不虛。他與人共同創辦的巴黎公司 AMI Labs,在他離開 Meta 後成立,正打造他所稱的「世界模型」:這類系統透過影片和感測器資料,學習物理世界如何運作,而不是從文字中學習。這位以神經網絡研究促成當前 AI 熱潮的科學家,如今正以自己的聲譽押注,宣稱這波熱潮的核心技術其實走了冤枉路。

他的姓氏原本寫作 Le Cun,源自古布列塔尼姓氏 Le Cunff,家族來自布列塔尼北部甘岡一帶。他出生於巴黎北郊的蘇瓦西蘇蒙莫朗西,在 ESIEE Paris 接受工程師訓練,並於 Université Pierre et Marie Curie 取得電腦科學博士學位。他的論文提出一種早期反向傳播形式;這項程序讓神經網絡能從錯誤中自行修正,也是如今幾乎所有被稱為人工智慧的系統背後的基礎。之後,他前往多倫多,在傑弗里·辛頓(Geoffrey Hinton)門下擔任博士後研究員一年。

取得博士學位一年後,他加入位於新澤西州霍姆德爾的 AT&T Bell Laboratories。在那裡,他打造出名為 LeNet 的卷積神經網絡,讓系統透過觀察範例學會辨識手寫數字。他協助開發的支票辨識系統,後來獲 NCR 和其他公司廣泛採用。1996 年,他加入 AT&T Labs-Research 負責影像處理,並與萊昂·博圖(Léon Bottou)及派屈克·哈夫納(Patrick Haffner)合作開發 DjVu。這種掃描文件壓縮格式至今仍由 Internet Archive 用來提供數位化書籍。

神經網絡後來失寵,勒昆卻仍持續研究。他於 2003 年轉至紐約大學(NYU),至今仍擔任 Courant Institute 的 Jacob T. Schwartz 講座教授;2012 年,他成為該校 Center for Data Science 的創始主任,隔年又與約書亞·班吉歐(Yoshua Bengio)共同創辦 ICLR 會議。深度學習捲土重來時,靠的正是他、班吉歐和辛頓在低潮時期仍堅持的理念。三人共同獲得 2018 年圖靈獎——電腦科學界的最高榮譽——也因此至今仍被報章稱為「AI 教父」。當時勒昆已在 Facebook 任職五年:公司於 2013 年 12 月聘用他,成立 AI 研究實驗室 FAIR。

FAIR 成為業界最開放的研究實驗室之一,公開發表論文與程式碼;勒昆也成為業界最積極倡議開放模型權重的人,讓任何人都能以此為基礎進一步開發。實驗室訓練出第一個 LLaMA,並於 2023 年 2 月向研究人員發布。實驗室也推出 Galactica,這款科學寫作模型的公開示範版,於 2022 年 11 月推出約 48 小時後便遭 Meta 下架,原因是使用者指出它會信心十足地編造荒唐內容。兩週後 ChatGPT 問世,受到大眾喜愛;勒昆後來表示,當時世界還沒有準備好迎接 Galactica。到了 2025 年,馬克·祖克柏(Mark Zuckerberg)將 Meta 的 AI 業務交由王令(Alexandr Wang)領導,並成立新的超級智慧部門;勒昆改為向王令報告,FAIR 也在 10 月裁員中受到衝擊。11 月,他宣布將於年底離職。

談到勒昆,難處在於他對長遠趨勢往往看得準,卻常以強硬態度看待眼前局勢。多年來,他一直主張大型語言模型無法推理或規劃,但以這些模型為基礎的聊天機器人,已成為業界最主要的生意。離職幾週後,他接受《金融時報》(Financial Times)訪問時稱,Meta 的 Llama 4 基準測試結果「有一點灌水」,不同測試使用了不同版本的模型;這項指控首次浮上檯面時,Meta 生成式 AI 負責人艾哈邁德·阿爾達赫勒(Ahmad Al-Dahle)曾予以否認。在 AI 風險問題上,他與同為圖靈獎得主的同儕立場迥異:辛頓和班吉歐如今警告 AI 可能威脅人類,勒昆則在 2026 年 10 月告訴《財星》(Fortune),自己完全不擔心人類滅絕,稱有效利他主義「毒性極強」,並批評 Anthropic 執行長達里奧·阿莫代伊(Dario Amodei)「完全活在妄想中」。他認為,警告 AI 太危險、不該交到大眾手中,就是一種監管俘虜。批評者則反駁,他的樂觀態度,很大程度上建立在對部署這些系統的人抱持信任之上。

AMI Labs 是一場將以成敗為這場爭論定論的押注。公司於 2026 年 3 月亮相,以 35 億美元投前估值募得 10.3 億美元;勒昆稱這是史上規模最大的種子輪融資之一。本輪由 Cathay Innovation、Greycroft、Hiro Capital、HV Capital 和 Bezos Expeditions 共同領投,其他投資者還包括 Nvidia、Samsung 和 Toyota Ventures。曾經營健康科技新創公司 Nabla 的亞歷山大·勒布倫(Alexandre LeBrun)出任執行長;勒昆則擔任執行董事長,並繼續在 NYU 任教。公司總部設於巴黎,在紐約、蒙特婁和新加坡設有團隊,員工約 60 人;其模型以 JEPA 為基礎,也就是勒昆多年來倡議的聯合嵌入預測架構,初期目標是機器人、異常偵測等工業用途。勒布倫表示,商業應用可能還需要數年時間。2026 年 1 月,勒昆也成為 Logical Intelligence 技術研究委員會的創始主席;該公司正致力開發以能量為基礎的推理系統。

離開實驗室後,勒昆熱衷於業餘天文觀測:他宣布成立 AMI 時,貼文背景使用的正是面紗星雲,照片由他在自家後院拍攝。他同時擁有法國和美國公民身分,於 2026 年 7 月滿 66 歲,育有三子。他在 2019 年於法國出版的《Quand la machine apprend》中,提出自己對這個領域的看法。他也指出,公司名稱同時是法文的「朋友」一詞。

AMI 首款產品尚未公布名稱,預計即將推出;勒昆曾暗示,開放模型可能會是產品的一部分。這將是外界首次能直接檢驗世界模型是否真能做到他十年來所承諾之事。如果成功,這位業界一直稱為異議者的人,將再一次走在時代前頭,就像當年神經網絡復興時一樣。如果失敗,他對聊天機器人的警告依然有分量,只不過發出警告的,是一位曾握有十億美元資金打造替代方案的人。

標籤: , , , , ,

在 Google 中新增我們

討論

共有 0 則留言。