【免费】基于Spark Streaming的在线KMeans聚类模型研究-发表之家

基于Spark Streaming的在线KMeans聚类模型研究

作者：侯敬儒; 吴晟; 李英娜昆明理工大学信息工程与自动化学院; 昆明650500

mapreduce spark streaming 在线计算低延迟

摘要：针对基于MapReduce框架处理海量数据实时响应能力较差的问题,设计并实现了基于Spark Streaming的在线计算模型进行大规模的KMeans聚类分析。该模型将整个过程分为数据接入、在线训练等模块,各模块通过数据流连通形成任务实体,提交到Spark分布式集群运行完成。通过比对分析实验和性能检测,验证了该在线KMeans聚类模型具有高吞吐、低延迟的优势,且集群运行状况良好。

注：因版权方要求，不能公开全文，如需全文，请咨询杂志社

学术咨询免费咨询杂志订阅

热门期刊服务

科技与经济统计与经济计算机教育计算机与信息技术数值计算与计算机应用计算机工程与设计计算机技术与发展计算机辅助设计与制造电气技术与经济交通与计算机机械科学与技术审计与经济研究

基于大概念的语文教学基于智慧课堂的教与学基于核心素养的培养基于核心素养的教学方式基于模型的优化设计

计算机与数字工程

影响因子：0.35

期刊级别：统计源期刊

发行周期：月刊

服务介绍

基于Spark Streaming的在线KMeans聚类模型研究

计算机与数字工程

期刊咨询

订阅杂志

期刊推荐