基于MapReduce編程模型的TFIDF算法研究 | |
所屬分類:技術論文 | |
上傳者:aet | |
文檔大?。?span>381 K | |
所需積分:0分積分不夠怎么辦? | |
文檔介紹:隨著Internet等技術的飛速發展,信息處理已經成為人們獲取有用信息不可或缺的工具,如何在海量信息中高效地獲得有用信息至關重要,因此自動文本分類技術尤為重要。現有的文本分類算法在時間復雜性和空間復雜性上遇到瓶頸,不能滿足人們的需求,為此提出了基于Hadoop分布式平臺的TFIDF算法,給出了算法實現的具體流程,通過MapReduce編程實現了該算法,并在單機和集群模式下進行了對比實驗,同時與傳統串行算法進行了對比。實驗證明,使用TFIDF文本分類算法可實現對海量數據的高速有效分類。 | |
現在下載 | |
VIP會員,AET專家下載不扣分;重復下載不扣分,本人上傳資源不扣分。 |
Copyright ? 2005-2024 華北計算機系統工程研究所版權所有 京ICP備10017138號-2