第1745章一句話點醒了賈瀞雯
第1745章一句話點醒了賈瀞雯(第1/3頁)
第1745章一句話點醒了賈瀞雯
辦公室裡安靜得能聽見服務器風扇轉動的聲音。
李明盯著屏幕,右手放在鼠標上。
他點了一下,屏幕中央的小沙漏開始轉。
一秒,兩秒,三秒……十秒過去了。
屏幕終於刷新,顯示出一列結果。
“還是慢。”他歎了口氣。
賈瀞雯站在他身後,看著那些搜索結果。
李明剛才輸入的是“電腦價格”,出來的結果有七八條,但隻有兩條真正和電腦價格有關。
一條是電腦公司的介紹,另一條是去年的舊新聞。
剩下的,有一條是“電影《電腦奇俠》”,還有幾條是其他完全不相關的內容。
“準確率多少?”賈瀞雯問。
張濤在另一臺電腦前算了一下:“剛測了五十個關鍵詞,隻有十五個返回了有用結果。
準確率……百分之三十左右。”
會議室裡一片沉默。
五個年輕人都在,臉上的表情都差不多——疲憊,還有點沮喪。
他們已經連續工作了兩個月,做出了這個能跑起來的搜索引擎。
可效果實在不理想。
“速度呢?”賈瀞雯又問。
“平均響應時間十二秒。”王磊說,“最慢的一次等了半分鐘。
這還隻是在我們內網測試,如果放到真實的網絡上,有延遲,有帶寬限製,可能更慢。”
賈瀞雯點點頭。
她走到白板前,看著上麵密密麻麻的架構圖。
爬蟲、索引、分詞、排序……每個模塊都做了,每個模塊都能工作,可組合起來就是這個結果。
“問題出在哪兒?”她問。
李明站起來,走到白板前:“首先是索引結構。
我們現在用的是最簡單的倒排索引,但數據量一大,查詢效率就低。
需要優化數據結構。”
張濤補充:“分詞也有問題。
基於詞典的方法太死板,很多新詞、專業詞切分不準。
比如‘奔騰處理器’,我們的詞典裡冇有這個詞,就切成‘奔騰’和‘處理器’,但用戶可能搜‘奔騰處理器’整個詞。”
“排名算法也不夠聰明。”王磊說,“現在基本是按關鍵詞出現次數排序,但這樣很容易被垃圾頁麵鑽空子。
一個頁麵堆滿關鍵詞,就能排到前麵,可內容根本冇價值。”
賈瀞雯聽著,一條條記在本子上。
她知道這些技術問題,但她更知道另一個問題——時間。
錢花得比預期快。
服務器托管費、帶寬費、團隊工資……五百萬已經用掉一百多萬。
如果遲遲做不出像樣的產品,後續資金壓力會很大。
更關鍵的是信心。
團隊的熱情需要正反饋來維持,如果總是失敗,再好的願景也會磨滅。
“今天先到這裡。”賈瀞雯合上本子,“大家回去休息吧,明天
(本章未完,請點擊下一頁繼續閱讀)