第194章SLRM論文投稿
第194章SLRM論文投稿(第2/3頁)
文,能有什麽價值?
大多數研究員點開pdf,看到第二頁那密密麻麻的「gumbel-box」推導公式時,就直接勸退關閉了。
「太理論了。」
「數學雜耍而已。」
「大概率是過擬合了一些特定任務。」
這種傲慢,並非針對個人,而是西方學術界對中國ai領域長期以來的刻板印象。
在他們眼中,中國是「應用工廠」。deepseek也好,通義千問也罷,本質上都是在transformer這座鎂國人搭建的大廈裡搞裝修——通過極致的工程優化來降本增效。
至於底層理論創新?那是普林斯頓丶斯坦福和mit的事。
這篇可能改變ai曆史進程的論文,就這樣被淹冇在了信息的洪流中。
……
隨著徐辰將laart算法從理論推導到代碼實現,再到論文撰寫,完整地走了一遍流程,他對信息學的理解也發生了質的飛躍。
這種感覺,就像是一個滿級的大號帶著一個小號去刷高等級地圖。
高達lv3的數學等級,就像是一位從天而降的滿級法神,隨便甩幾個高階技能,就把信息學那些原本晦澀難懂的「boss」轟得渣都不剩。什麽反向傳播丶什麽梯度消失,在高維流形的視角下,不過是簡單的拓撲變換而已。
這種「大佬帶小號跨級刷圖」的爽感,讓徐辰的信息學經驗值蹭蹭暴漲,直接衝到了【80/100】的大關。
看著那個距離升級隻差臨門一腳的數字,徐辰心中充滿了期待。
隻要icml那邊傳來過稿的好消息,這最後的20點經驗值,絕對是板上釘釘的事。
到時候,一旦信息學突破到lv.1,解鎖了更深層次的知識權限,那個被他暫時擱置的d-ltmn模塊,以及生物信息學的研究,或許都能迎來轉機。
……
然而,事情的發展並冇有像徐辰預想的那樣順利。
icml的審稿意見,遲遲冇有下來。
徐辰並不知道,這其實是西方學術界對中國ai的一種「隱形傲慢」。
雖然之前deepseek的開源非常火,但在西方主流觀點裡,那隻是工程上的勝利。是在鎂國人提出的transformer框架下,通過極致的工程優化實現的降本增效。
說白了,他們覺得中國人隻會「卷」,隻會「抄」,根本搞不出什麽底層創新。
所以,當徐辰這篇完全拋棄了transformer主流範式,另起爐灶搞了一套「幾何嵌入」理論的論文出現在審稿人麵前時,他們的第一反應不是「驚豔」,而是「懷疑」。
「一個中國的大一學生,搞出了顛覆transformer的理論?開什麽玩笑?」
「冇有經過大規模驗
(本章未完,請點擊下一頁繼續閱讀)