
本文來自微信公眾號:字母ai,作者:小金牙,頭圖來自:視覺中國
外界關於meta的很多「八卦」都被一個重要人物實錘了。
《金融時報》的最新專訪中,楊立昆不僅親口承認了llama 4的「造假」,還回應了外界關於他與meta新晉ai一把手alexandr wang之間不和的傳聞。
他稱wang太年輕沒有經驗,也並不知道研究員想要什麼。
至於他自己,並沒有如外界所想像的那樣因為要給wang彙報工作而苦惱,因為wang「不能告訴像我這樣的研究人員該怎麼做」。
離開meta,在楊立昆口中更偏向於路線分歧——大部分meta的人被大語言模型「洗腦」,而楊立昆的心則早就飛向他認為更有前景的「世界模型」。
一、facebook往事
楊立昆出生於巴黎,他從很早的時候就認為,人類什麼都是後天習得的,智能的本質就是學習。
20世紀80年代博士畢業後,楊立昆奔赴加拿大,在多倫多大學跟隨「ai教父」傑弗里·辛頓進行博士後研究,後加入著名的貝爾實驗室。引入卷積神經網路是他最突出的貢獻之一,為此他被稱為「卷積神經網路之父」。
楊立昆回憶,在貝爾實驗室似乎有無窮的資金,這也幫助他將構想變為現實。他剛入職貝爾的時候,老闆曾告訴他:「你知道嗎,在貝爾實驗室,省錢是出不了名的。」
到2013年,深度學習的成功已成定局,圖像識別應用取得了令人矚目的成果。谷歌剛剛啟動了谷歌大腦項目,一年後便收購了英國人工智慧實驗室deepmind。
也是在那時,馬克·扎克伯格打來了電話。他想在facebook組建一個人工智慧部門。
為了爭取楊立昆的加入,扎克伯格邀請他到自己在加州的家中共進晚餐。
楊立昆回憶說,一位私人廚師準備了「雞肉,配上了一些很不錯的白葡萄酒」。
楊立昆最終同意加入,但有三個條件:他不必辭去在紐約大學的工作;他不必搬到加州;新實驗室的研究成果必須公開。
扎克伯格同意了,交易達成。楊立昆加入全球最大的科技公司之一facebook,組建一個新的人工智慧研究實驗室,專註於基礎研究,名為facebook人工智慧研究院(fair)。
楊立昆說,對當時的他來說,facebook就像一張白紙,可以讓他擁有完全的研究自由。「資金顯然不會成為問題。」
2018年,楊立昆作為「深度學習三劍客」之一,和辛頓等人一起獲得了圖靈獎,這是計算機領域的最高榮譽。
也是在那一年,楊立昆在facebook的頭銜發生了變化,從領導fair的ai總監,變為了整個公司的「首席ai科學家」。
三年後,扎克伯格醉心元宇宙,不惜將公司改名為meta。但元宇宙回報給扎克伯格的只有尷尬,但好在,ai的浪潮接踵而至,給了扎克伯格新的「救贖」。
而楊立昆和meta的故事,卻向著終點走去了。
二、心急的扎克伯格與llama「造假」醜聞
openai的chatgpt誕生後,meta內部一片混亂,公司領導層決定全力投入大型語言模型llama的開發。
llama,正生髮於楊立昆領導的fair部門。
扎克伯格成立了一個生成式人工智慧(genai)部門,負責加速產品研發。
楊立昆堅持要求公開發布該模型。llama 2發布時向所有用戶開放了權重,這意味著人們可以免費下載和調整模型,這是一個「分水嶺」時刻,它「改變了整個行業」。該模型成為開源llm的黃金標準,展示了一種與谷歌和openai完全不同的風貌,後者封閉且權力集中。
如此這般,meta一度視為人工智慧研究領域的「好人」。
然而,楊立昆透露,扎克伯格對genai部門施加了更大壓力,要求其加快人工智慧的研發和部署,這導致了溝通不暢。
「我們有很多新想法和非常棒的東西,他們應該付諸實施。但他們卻只選擇那些基本上安全可靠、已被證明行之有效的東西。這樣做,你就落後了。」
後續的llama系列產品都表現不佳。
2025年4月發布的llama 4更是慘遭滑鐵盧,meta還被指控操縱基準測試結果以使其看起來更出色。
這次的採訪中,楊立昆承認「結果確實有些造假」,團隊為了獲得更好的測試結果,在不同的基準測試中使用了不同的模型。
「馬克(扎克伯格)非常生氣,基本上對所有參與此事的人都失去了信心。所以他基本上把整個genai組織邊緣化了。很多人已經離開了,還有很多人還沒離開,他們也會離開。」
在這之後,meta快速進入「後llama」時代。
去年六月,meta 向數據標註初創公司scale ai 投資超過140億美元,並聘請了其28歲的聯合創始人兼ceo alexandr wang。
wang成為了首席ai官,領導新成立的「超級智能實驗室」,這個新部門吞併了meta過去已有的ai部門。此外,wang還直接負責監督開發前沿人工智慧模型的工作,llama乃至整個開源路線都眼瞅著被扎克伯格拋棄了。
在這個過程中,meta還曾因試圖以1億美元的簽約獎金從競爭對手那裡挖走頂尖研究人員而登上新聞頭條。
「未來會證明這究竟是好主意還是壞主意。」
楊立昆稱wang「年輕」且「缺乏經驗」。
「他學得很快,也知道自己不懂什麼……但他沒有科研經驗,不知道如何開展科研,也不知道科研人員會喜歡什麼,不喜歡什麼。」
但他否認被wang指揮做事。
首先,他強調自己並不怕與年輕人共事:「當時(我加入這家公司的時候)facebook工程師的平均年齡是27歲。我的年齡是工程師平均年齡的兩倍。」
其次,wang對他的影響力有限:「alex(wang)也沒有告訴我該怎麼做。你不能告訴研究人員該怎麼做。你更不能告訴像我這樣的研究人員該怎麼做。」
三、離開meta,創辦新公司
否認了wang對自己的影響力,楊立昆解釋自己為何離職的時候更多強調路線的不同。
他說,繼續留在meta在政治上變得困難重重。雖然扎克伯格欣賞楊立昆的世界模型研究,但公司新一輪超級智能項目招聘的那批人卻「完全被大語言模型(llm)洗腦了」。
楊立昆被疏遠了。
「我確信meta公司里很多人,或許包括alex(wang)在內,都不希望我告訴世人——llm在超級智能領域基本上是一條死路。但我不會因為某些人認為我錯了就改變我的想法。我沒錯。作為一名科學家,我的職業操守不允許我這樣做。」
他認為,大型語言模型雖然有用,但本質上受到語言的限制。要達到人類水平的智能,就必須理解我們所處的物理世界是如何運作的。
為達到這個目的,他寄希望於v-jepa的架構,即所謂的「世界模型」。世界模型旨在通過學習視頻和空間數據(而不僅僅是語言)來理解物理世界。這種模型還能夠進行規劃、推理並擁有持久記憶。
他將這種智能稱為「先進機器智能」(advanced machine intelligence,簡稱ami)。
促使他離開的另一個原因是,他利用世界模型和ami 所做的工作也展現出meta不感興趣的潛在用途,例如噴氣式發動機和重工業。
當然,meta不賞光,楊立昆也毫不費力地找到了願意投資「下一代人工智慧技術」的投資者。
四、未來屬於「世界模型」?
楊立昆離開meta後,將創立自己的公司,名叫「先進機器智能實驗室(advanced machine intelligence labs )」。
新公司的ceo將由法國醫療保健人工智慧初創公司nabla的聯合創始人兼首席執行官亞歷克斯·勒布倫領導。楊立昆自己擔任執行董事長。
「我是一名科學家,一個有遠見的人。我能激勵人們去做有趣的事情。我很擅長預測哪種技術會成功,哪種會失敗。但我當不了ceo,我既太缺乏條理,也太老了!」
楊立昆認為自己進入了新的、最具發展潛力的領域。
對於openai前首席技術官的新公司「思考機器實驗室(thinking machines lab)」,楊立昆說:「希望投資者知道自己在做什麼。」
對於openai聯合創始人兼前首席科學家伊利亞·蘇茨克維的新公司「安全超級智能(safe superintelligence)」,楊立昆評價:「我知道投資者根本不知道自己在做什麼。」
相比之下,他的新架構充滿希望——利用視頻讓人工智慧模型理解我們世界的物理規律,從而使它們能夠更好地預測接下來會發生什麼。該模型還依賴於「情感」,即過去的經驗和評估,來指導其預測。
「如果我掐你一下,你會感到疼痛。但你對我的心理認知會受到我掐你這件事的影響。下次我再靠近你的時候,你會本能地躲開。這就是你的預判,它(掐一下)引發的情緒是恐懼或對疼痛的逃避。」
楊立昆透露,這種技術的「雛形」會在12個月內問世,並在幾年內有更大規模的版本。它還不是超級智能,但卻是通往超級智能的一條道路。
「也許有某些尚未被發現的障礙,但(這條路)至少還有希望。」
當被問到希望給這個世界留下什麼,楊立昆毫不猶豫地表示,提高智能水平才是關鍵。
「我們真正應該擁有的就是更多的智能。」有了更多的智能,人類的苦難就會減少,決策會更加理性,對世界和宇宙的理解也會更加深刻。
「我們飽受愚蠢之苦。」
本內容由作者授權發布,觀點僅代表作者本人,不代表虎嗅立場。如對本稿件有異議或投訴,請聯繫 [email protected]。