第1765章遇到問題,分析問題,解決
第1765章遇到問題,分析問題,解決(第1/3頁)
第1765章遇到問題,分析問題,解決問題
賈瀞雯回到北京時是周一早上。
她冇回家,直接拖著行李箱去了辦公室。
團隊五個人都在,正圍在白板前爭論什麼。
看到她進來,所有人都轉過頭。
“賈總回來了!”
“陳總有什麼指示嗎?”
賈瀞雯放下行李箱,脫掉外套:“先說說你們這邊的進展。”
李明趕緊彙報:“索引結構優化做了第一版,測試結果顯示查詢速度能提升百分之二十左右。
但有個問題,內存占用增加了。”
“分詞算法呢?”
張濤接過話:“常見歧義解決了一部分,但遇到新的問題。
比如‘南京市長江大橋’,可以分成‘南京市長-江大橋’,也可以分成‘南京市-長江大橋’。
這種結構歧義,靠詞典解決不了。”
賈瀞雯點點頭,走到白板前。
她拿起筆,在空白處寫下幾個字:超鏈分析。
“陳總提出了一個新概念。”她轉身看著團隊,“叫超鏈分析。
簡單說,就是通過分析網頁之間的鏈接關係,來判斷網頁的重要性。”
五個人都愣了。
“鏈接關係?”王磊問,“什麼意思?”
“一個網頁如果被很多其他網頁鏈接,說明它可能比較重要,比較權威。”賈瀞雯解釋,“反過來,如果一個網頁鏈接了很多重要網頁,那它自己可能也是個樞紐。
通過分析整個網絡的鏈接結構,我們可以給每個網頁打分,這個分數可以用於搜索結果排序。”
會議室裡安靜了幾秒。
李明眼睛慢慢亮起來:“這思路……太牛了。
等於是把整個互聯網當成一個投票係統,每個鏈接就是一票。”
張濤也反應過來:“對!這樣就能解決垃圾頁麵堆關鍵詞的問題了。
那些垃圾頁麵不會被其他頁麵鏈接,分數自然低。”
“但實現起來很難。”王磊皺起眉,“我們需要分析整個網絡的鏈接結構,這計算量太大了。”
賈瀞雯放下筆:“所以陳總說了,先做簡化版。
不分析整個網絡,隻分析我們已收錄的十萬網頁。
先驗證這個思路是否可行。”
她看著團隊:“陳總給了兩周時間。
兩周內,我們要做出超鏈分析的第一版,集成到排名算法裡。”
任務定下來了,但怎麼開始,誰都冇底。
第一天,團隊在查閱資料。
超鏈分析這個概念,國外有論文提到過,但冇見到實際應用。
他們需要自己從頭設計算法。
第二天,李明在白板上畫出了第一版架構圖:“我們需要建兩個矩陣。
一個記錄每個網頁的出鏈,一個記錄入鏈。
然後迭代計算,直到收斂。”
“收斂條件呢?”
“每個網頁的分數變化小於某
(本章未完,請點擊下一頁繼續閱讀)