吴忠躺衫网络科技有限公司

您好,歡迎來電子發燒友網! ,新用戶?[免費注冊]

您的位置:電子發燒友網>源碼下載>數值算法/人工智能>

一種在分布式環境下實現冪迭代聚類的方法

大小:0.69 MB 人氣: 2017-12-11 需要積分:1

  為解決冪迭代聚類算法并行實現中存在的編程繁瑣、效率低下等問題,基于Spark大規模數據通用計算引擎及其GraphX組件,提出了一種在分布式環境下實現冪迭代聚類的方法。首先,利用某種相似性度量方法,將原始數據轉換成一個可以視為圖的親和矩陣;然后,通過頂點切割,把行歸一化后的親和矩陣切分成若干個小圖,分別存儲在不同的機器上;最后,利用Spark基于內存計算的特點,對存儲在集群中的圖進行多次迭代計算,得到這個圖的一個切割,圖的每一個劃分子圖對應一個類簇。在不同規模的數據集和不同executor個數下進行的實驗結果表明,基于GraphX的分布式冪迭代聚類算法具有良好的可擴展性,算法運行時間與executor個數呈負相關的線性關系,在6個executor下,與單個executor相比,算法的加速比達到了2.09到3.77。同時,通過與基于Hadoop的冪迭代聚類進行對比,在新聞數量為40000篇時,運行時間降低了6l%。

一種在分布式環境下實現冪迭代聚類的方法

非常好我支持^.^

(0) 0%

不好我反對

(0) 0%

      發表評論

      用戶評論
      評價:好評中評差評

      發表評論,獲取積分! 請遵守相關規定!

      ?
      百家乐官网玩家技巧分享| 鄱阳县| 网上百家乐心得| 太原市| 大发888娱乐场东南网| 百家乐赌缆十三式| 百家乐官网博彩通| 八大胜娱乐场| 财神百家乐的玩法技巧和规则 | 百家乐官网电投| 剑川县| 威尼斯人娱乐城博彩网| 百家乐玩法皇冠现金网| 百家乐官网娱乐平台网77scs | 大发888八大胜博彩| 24山家坐向| 送彩金百家乐官网平台| 云顶国际平台| 大发888怎么修改密码| 英皇百家乐的玩法技巧和规则| 百家乐网站那个好| 尊龙百家乐官网赌场娱乐网规则| 百家乐官网分析概率原件| 黄骅市| 真人百家乐官网打法| 永利高足球投注网| 金都娱乐城真人娱乐| 大发888老虎机苹果版| 金博士百家乐娱乐城| 百家乐注册开户送现金| 什么风水适合做生意| 百家乐官网平注法到6| 真人百家乐官网是真的吗| 百家乐官网平台有什么优势| 百家乐双龙出海注码法| 澳门百家乐心德| 属鸡和属猪做生意好吗| 最好的百家乐官网好评平台都有哪些| 大发888体育在线投注平台| 威尼斯人娱乐城网址| 大发888注册58|