第656章專訪(上)
第656章專訪(上)(第3/3頁)
調用它的api接口。”
他用雙手在空中模擬著連接的動作。
“我要加一個卷積層,啪,調用一個模塊;我要加一個池化層,啪,再加一個模塊。這幫我屏蔽了所有的底層複雜性。”
“而且每一個模塊應該怎麼樣使用,在什麼樣的情況下使用,官方的文檔裡麵,都給了比較詳細的示例代碼和教程。”
蘇晚晴看著他專註的表情,繼續發問。
“也就是說,你並不需要理解每一行底層代碼的邏輯,也能完成頂尖模型的訓練?”
顧超凡非常坦誠地點頭。
“是的。外網那些大牛管這個叫深度學習前沿研究。我倒感覺這種操作像是‘煉丹’。”
蘇晚晴笑了出聲。
“煉丹?為什麼這麼叫?”
顧超凡也跟著笑了起來。
“因為很多時候,我也不完全確定為什麼加了這一層,準確率就會提升。”
“我就是在框架裡不斷地調整參數。”
“改一改學習率,調一調批次大小,然後把數據喂進去跑。”
“就像古代道士把藥材扔進煉丹爐裡,看看最後能煉出個什麼東西來。”
他收起笑容,語氣變得認真。
“但是,能夠讓我這樣不斷試錯、不斷‘煉丹’的前提,是這個丹爐必須足夠好用。”
“tensorflow幫我處理了顯存分配、跨硬件調用這些最麻煩的事情。如果讓我自己去寫cuda代碼來調度gpu,我估計寫三年都寫不出一個能跑的demo。”