我的學習群裡全是真大佬 第481章

作者:胖胖的小橘

龔校長聽完,沉默了。

過了會兒,他才開口問了一句。

“很重要?”

李東想到了小黑,想到了田鋼的專案,最後點了點頭說道。

“還是,挺重要的。”

龔校長盯著他看了兩秒,也點了點頭。

“行。”

“這事兒我得琢磨琢磨,明天給你個準信兒。”

“那就麻煩校長了。”

李東點了點頭,起身準備告辭。

可他人還沒走到門口,身後龔校長忽然又把他叫住了。

“哎,李東教授。”

李東回過頭。

“今年,多大了?”

這話問得沒頭沒腦,李東愣了一下,才老實答道。

“二十一。”

“今年四月二十四號,剛滿的。”

“談女朋友了嗎?”

李東:???

啥意思呀?出個國還要還要調查這些的嗎?

還是說……

燕大現在,連這個……都包分配了嗎?

第398章 好多老錢

隨著李東的身影離開辦公室,龔校長這才嘆了口氣。

二十一歲呀,菲爾茲獎得主。

本事越大,外面盯著的眼睛就越多。

這回是出去開會,那下回呢?

還是要成家呀。

成了家人就有了牽掛,心也就定下來了。

可問題是……哪裡去找學問上得聊得來,年紀相當,性子還得處得來呀。

“哎。”

他又嘆了口氣,這才拿起桌上的電話撥了出去。

……

韓國,首爾。

一輛黑色轎車,不緊不慢地朝著三成洞方向開去。

李東坐在後排,有些發呆,他是真沒想到,自己在首爾還有專車。

老吳開著車,老張坐在副駕,從上車起就沒有回過頭,目光一直在觀察著周圍的情況。

李東閒著沒事,用手指在車窗玻璃上敲了敲。

篤,篤。

聲音發悶,一點都不像正常玻璃該有的脆響聲。

李東還想問問老張這到底是啥玻璃,然而看見老張正目視前方,透著一股生人勿進的氣場,他也就打消了問的想法。

此時車子拐過一個路口,一大片玻璃幕牆的建築就出現在了眼前。

COEX會展中心到了。

這會兒會展中心門前的落客道上,已經排起了長隊。

清一色的高檔轎車,緩緩往前蹭。

會展中心的外牆上,掛幾幅兩層樓高的條幅。

【ICML 2026】

【第四十三屆國際機器學習大會】

李東隔著車窗看著外面的豪車,心裡忍不住感嘆了一句。

這都特麼是有錢人呀。

不過也正常,誰叫這幾年AI是風口呢?這場大會來的可不只是學者,還有各家的VP以及風投。

當前沿技術和資本湊到一處,門口的車能不值錢嗎。

車停穩以後,老張先一步下車,替李東拉開車門,隨後跟在了李東的身後。

前面不遠處幾輛商務車也剛剛停下,水木大學的隊伍也下車了。

李東朝著隊伍走了過去。

這一次水木帶隊的,是唐傑教授。

他牽頭做的那套千億引數大模型底座早就過了B輪敲了鍾,是各路資本的常客。

這樣的盛會,他自然不會錯過。

唐傑身後還跟著十來個水木的博士生、碩士生,一個個眼睛裡都帶著光。

這次他們來這種頂會,主要是有的人論文過了稿,來交作業的。

也有被選中做Oral到時候要上臺扛住Peer Review的炮火彙報工作的。

剩下的就是長見識的,然後在Poster Session(海報環節)看看能不能吸引來一些大佬指點幾句。

當然這場大會本身就是一個高階人才市場,大廠展臺上拿高薪HC收履歷,向來比網申痛快得多。

所以這一隊學生,從下車起就恨不馬上進去。

唐傑回頭交代了學生們幾句,轉過身來,先看了一眼李東身後的老張,然後才朝著李東笑道。

“李東教授。”

“唐教授。”李東也笑著點頭問好,然後才指了指那些豪車。

“這個大會,規格很高啊。”

“哈哈,因為有錢人多嘛。”

他說完這句話,李東則是上下打量了下他那套價格不菲的西裝

唐傑先是一怔,隨即哈哈大笑,擺著手往大門裡走。

“學校發的工資,學校發的工資。”

……

進了會場,李東才算真正見識了什麼叫頂會,ICM和這一比起來,確實顯得有些小氣了。

將近一萬人的註冊規模,幾層樓的會場早就被人群塞滿了。

而且海報廳都有記者在,因為有資本圈的大佬也在逛著這些展區。

而企業展區,各家的展臺一個賽一個的氣派大螢幕上滾著SOTA(當前最佳效能)級別的Demo,穿文化衫的員工見人就遞宣傳冊。

李東跟著水木的隊伍,聽了一上午的報告。

不得不說,有幾場是真讓他開了眼界。

頭一場主旨報告,是GPT那邊的一位研究負責人講的他們這兩年悄悄押下重注的一條新路。

過去幾年,圈子裡卷的都是Pre-training(預訓練)的規模。

而他們換了打法,把算力槓桿翹到了Inference(推理)端。

簡單的說就是給模型引入System 2的慢思考機制,讓它在吐出答案前先在隱空間裡窮舉推理樹。

這樣一步一步生成思維鏈(CoT),走入死衚衕就觸發回溯機制,直到把邏輯閉環徹底打通再輸出結果。

而這種深層推理的泛化能力,根本沒法靠人力標註去微調,完全是靠RL(強化學習)結合自博弈硬生生刷出來的。

專門挑選數學證明和程式碼生成這類具備明確客觀真值(Ground Truth)的任務,模型推導對了就給高維獎勵訊號,錯了就切斷反向傳播。

成千上萬輪的PPO策略迭代下來,模型自己就湧現出了極為恐怖的試錯與糾偏本能。

臺上直接甩出了一張Test-Time Compute(測試時算力)的對數曲線。

同一套基座權重,只要允許模型在推理階段多消耗十倍的Token進行內部演算,Hard級別任務的準確率直接順著曲線呈現指數級爬升。

報告還沒講完,臺下已經是一片低低的議論聲。

李東坐在水木的隊伍中間,心裡微微一動。

數學,恰恰就是這世上提供最優驗證獎勵反饋的終極資料集。

第二場的Oral是來自普林斯頓和卡內基梅隆的一支聯合團隊,講的是一種顛覆性的非Transformer底層架構。

他們拿狀態空間模型做線性遞迴,時間複雜度從平方砍到線性,百萬Token一口氣吞下去,視訊記憶體都不怎麼漲。

臺下搞理論的當場就槓上了,兩邊誰也說服不了誰。

至於最後一場,Gemini那邊一位研究員講的是世界模型。

他們不喂文本,直接喂影片,逼模型自己學會物理。

練到最後,給模型一張圖就能憑空生出一個三維世界。

一上午聽下來,李東心裡大致也有了數

國外這幾家卡在Scaling Law最前沿的巨頭,早就跳出了單純堆積引數量和清洗語料的低效內捲區,一個個全在底層範式上變道。

比的不再是誰的萬卡叢集規模更大,而是誰先在架構和推理機制上完成破局。

這些學術直覺,確實敏銳到了極點。

反觀國內,多數廠家還在舊的紅海路線裡跟進。

猛灌通用指令微調,卷引數規模,刷榜單的分數,卷B端落地商業化。

報告也多半集中在分散式訓練的通訊最佳化或者視訊記憶體切分等工程Trick上。

不過……

當然也是不是全,也有一些國內團隊搞出了一些不一樣的東西。

有兩篇做長序列高效KV Cache稀疏化的,還有一篇用大模型反向生成高質量合成數據做自我蒸餾的,思路一樣驚豔,臺下舉手要論文原始碼的人一樣很多。

更有意思的是開源基座這條路。

國外頂尖名校的博士生們如今跑消融實驗,底層模型十有八九載入的都是華夏的開源權重,呼叫便宜,對齊做得好,魔改介面還很開放。

這一條生態護城河上,反倒是國內走在了前列。

……

第399章 李東來了

中午休息的時候,主會場外的大廳裡。