第354章群星閃耀大模型
第354章群星閃耀大模型(第5/6頁)
時候,能夠照亮人類群星。
這麼說,當1971年阿美莉卡試圖以一己之力脫離布雷頓森林協定的時候,人類經濟學家都不知道這意味著什麼的時候,群星閃耀能夠給予人類指引。
當蘇俄陷入困境,在經濟上艱難困苦,石油高企過去的時候,有群星閃耀能夠告訴他們,到底犯了什麼錯。
當華國,華國冇啥問題。
總之就是群星閃耀。
“我可以簡單和大家說一下,你們的工作可能涵蓋哪些內容,如果我來做,我會從什麼角度著手。
最重要的其實是數據,數據需要聚焦於高質量、特定領域的文本,像哲學的倫理文本,形而上學的著作,社會學的理論研究和實地調查報告,政治學的政策文件、數據文本之類的。
你要找這些,總得知道到哪裡去找論文索引,知道到哪裡去找開放資源,如果這些不夠,要購買的話,到領域期刊去收集數據。
開放的數據收集完,如果需要,再聯係綜合部去找領域期刊收購他們完整數據庫的使用權。
我預計需要確保至少500億的tokens,來確保專業深度。
確定數據之後要對數據進行清洗吧,要去除噪聲重複以及具有偏見的內容。
一些文本也許很熱門,有超多引用或者下載,但實際上內容並無價值,這也需要大家來判斷。
這是數據階段要做的工作,在模型開發和訓練階段,你們可以直接用深紅來訓練,不需要從頭開發,直接讓工作人員協助你們基於現有模型進行訓練。
如果訓練結果不滿意,需要對模型調整,那麼你們可以先自己試試看,有什麼不懂的,你們發郵件給我,我安排時間來為大家提出解答。
我的目的是,希望大家能夠開放出一個,足夠中立客觀專業的模型,外界在使用的時候,丟任何一個社會議題給它,它都能給出足夠專業的解答。
如果足夠好的話,我會考慮把它賣給微博,成為微博社會議題的獨立客觀第三方意見。
所以,各位,你們的工作很有意義。”
林燃內心實際上在想,各位,不是很有意義,是非常有意義,它可能會改變整個時代的走勢,改變整個世界。
至於為什麼不自己做?
因為林燃在這個時空要呆很長一段時間,他不想專門花時間來做這個,丟給學生,在深紅現有資源下,當成是一個練手的課題恰好合適。
又不是這個暑假就要做完,會當成一個課題,一直推進,這屆做不完,新一批學生進來之後繼續做,本身交大的生源一年比一年好,林燃數學班的門檻也一年比一年高。
他要在這呆七年左右,時間綽綽有餘。
“大家通過這個課題,能夠接觸到幾乎所有的人工智能大模型需要做的工作,我
(本章未完,請點擊下一頁繼續閱讀)