法師歸來,速通地球!

第10章忽悠傻了

加入書簽 推薦本書

第10章忽悠傻了(第2/3頁)

節約時間。

我覺得這是非常具備可行性的方案,給他一點機會未嘗不可。

你也說過,大部分時候求穩,但當機會出現的時候,該賭就得賭。”

趙立明被氣笑了:“我是讓你該賭的時候就賭,但你看看他背景,唯一有可信度的背景是來自伊戈爾·巴布什金的背書,還隻是遠程聊過。

他冇有去矽穀,冇有在deepmind工作,也冇有在推特工作。

背書力度太弱了,你明白嗎?

另外,你以為用gpt的數據來訓練是什麼很了不起的方案,是什麼天才的靈光一閃。

那是因為你了解的太少,你冇有從事這一行,你在江城科技大學學的是四十年前的數據結構和c語言。

你冇有關註開源社區的前沿動態。

華盛頓大學和艾倫人工智能研究所在chatgpt發布的第一時間就發表了論文,論文名字叫self-instruct。

你所謂的用gpt數據訓練隻是一句話,人家已經寫成論文,並且進行了實驗。

self-instruct的核心內容就是讓大模型自己生成自己的訓練數據。

他們把方法都公布了,一個迭代的過程。

先準備一小批人工寫的指令,這些作為例子來引導模型生成新任務。

用當前模型提示它生成新的、更多樣的指令。

比如給它幾個種子例子,讓它發明新任務。

為每個新指令生成輸入和輸出。

對生成的指令,再讓模型生成對應的input和 output。

這樣就得到一條完整的instruction、input和output三元組。

過濾低質量數據,用啟發式規則自動過濾無效的任務、與已有任務重複度太高的、輸出質量差的。

把過濾後的高質量數據加回任務池,可以繼續迭代生成更多數據。

最後用這些合成數據對原始基座模型進行監督微調。

你以為的靈光一閃,人家早就想到了並且實踐落地了。

你以為自己發現了天才,殊不知人家可能隻是比你懂得多一點呢!

你以為他有知識,可能他隻是有知道呢?”

(ps:上述是yizhong wang在2022年12月20日掛在arxiv上的論文,論文全稱:self-instruct: aligning language models with self-generated instructions,也是蒸餾方法的開創者。

其中艾倫人工智能研究院是由微軟聯合創始人保羅·艾倫於2014年創立的一家專註於人工智能前沿研究的機構。)

在江城大學湖濱七舍被室友們吹上天的陳神,在江城富人區的彆墅裡,在趙立明

(本章未完,請點擊下一頁繼續閱讀)

上一頁 章節目錄 下一頁

小說推薦:冇看黃曆:全小區都跟我穿越了鬥破之平凡人生我的人格超會演【卡牌扮演】全民饑荒:從養蜂人到蟲群主宰網遊:從職業打金人到黑夜帝王全民怪物,我成唯一玩家!廢土人命如草芥?我有外賣係統!綜影視修仙:手握命運選擇簽到係統僭主末日遊戲:對付外掛純靠勁兒大這一定不是克蘇魯!超凡公路:開局被全班女生驅逐喪屍之生存錄惡女萬人嫌?主角怎麼纏著叫妹寶