第256章全球AI公司都得上供!
第256章全球AI公司都得上供!(第1/4頁)
第256章全球ai公司都得上供!
蘇風拎著大包小包回到家,把東西往沙發上一扔,整個人直接癱了進去。
他靠在沙發上歇了會兒,掏出手機翻了翻。
屏幕上有幾條消息,最上麵是趙明遠發來的。
“蘇總,註冊材料我這邊已經提交了,特拉華州那邊效率很高,大概一周左右能下來。
辦公室我看了幾處,曼哈頓中城有個共享辦公空間,環境不錯,前期夠用了。
另外招聘的事我也在推進,量化研究員和交易員各發了幾份offer,等你下次來美利堅的時候應該就能見著了。”
蘇風回了一條:“辛苦了,資金這周內到位。”
趙明遠秒回:“收到。”
蘇風靠在沙發上,腦子裡過了一遍接下來的時間線。
三月份中旬國家集訓隊報到,六月份imo,中間還有幾個月的時間。
除了這些雜七雜八的事,還有兩件更大的事在等著他。
第一件事是2016年3月,alphago對戰李世石。
這場人機大戰會把整個人工智能行業徹底點燃,資本、人才、關註度會像潮水一樣湧進來。
當然這都是後話。
眼下最重要的,是先把transformer的專利和論文搞定。
transformer這東西,說複雜也複雜,說簡單也簡單。
核心就那幾個東西,自註意力機製、多頭註意力、位置編碼、殘差連接、層歸一化。
難的不是原理,難的是在2016年這個時間節點,全世界冇有人想到可以這麼乾。
現在的自然語言處理圈子,還是rnn和lstm的天下。
序列模型嘛,一個字一個字地處理,就跟人說話似的,一個詞接一個詞往下順。
這思路聽著合理,但有個致命的毛病,太慢了。
你不能並行計算,後麵的字得等前麵的字算完才能開始。
而且長句子跑到後麵,前麵的信息就丟得差不多了,跟金魚一樣記憶力隻有七秒。
但是自註意力機製不一樣。
蘇風現在要做的先申請專利,再寫一個簡單transformer框架,以及最後發表論文。
先說專利,這是最關鍵的一點。
前世,穀歌2017年6月才把transformer論文丟上arxiv。
他們的專利更是拖到2019年才在美國授權,而且寫得窄,隻保護原版編碼器-解碼器那一整套架構。
結果呢?
後來openai搞gpt,隻用解碼器,直接繞過去了。
bert隻用編碼器也繞過去了。
穀歌手握這麼個核彈級彆的專利,最後愣是冇收上幾個錢。
說白了,穀歌那幫研究員都是學術腦,先發論文再補專利,順序搞反了。
論文一公開,很多保
(本章未完,請點擊下一頁繼續閱讀)