期刊导航
期刊开放获取
vip
退出
期刊文献
+
任意字段
题名或关键词
题名
关键词
文摘
作者
第一作者
机构
刊名
分类号
参考文献
作者简介
基金资助
栏目信息
任意字段
题名或关键词
题名
关键词
文摘
作者
第一作者
机构
刊名
分类号
参考文献
作者简介
基金资助
栏目信息
检索
高级检索
期刊导航
共找到
2
篇文章
<
1
>
每页显示
20
50
100
已选择
0
条
导出题录
引用分析
参考文献
引证文献
统计分析
检索结果
已选文献
显示方式:
文摘
详细
列表
相关度排序
被引量排序
时效性排序
MapReduce模型在大规模数据并行挖掘中的应用
被引量:
1
1
作者
唐婧
杜微
周翼
《智能物联技术》
2024年第2期38-42,共5页
MapReduce并行编程模型通过定义良好的接口和运行支持库,能够自动并行执行大规模计算任务,隐藏底层实现细节,降低并行编程的难度。系统阐述MapReduce的基本工作原理及其工作流程,以TeraSort算法为例,针对其存在的问题,提出动态数据分区...
MapReduce并行编程模型通过定义良好的接口和运行支持库,能够自动并行执行大规模计算任务,隐藏底层实现细节,降低并行编程的难度。系统阐述MapReduce的基本工作原理及其工作流程,以TeraSort算法为例,针对其存在的问题,提出动态数据分区和数据压缩等优化建议。研究成果表明,优化后的TeraSort算法能够显著缩短数据处理时间,优化系统的吞吐量,并改善资源分配的均衡性。
展开更多
关键词
MAPREDUCE
大规模数据
并行挖掘
terasort
在线阅读
下载PDF
职称材料
一种周期性MapReduce作业的负载均衡策略
被引量:
15
2
作者
傅杰
都志辉
《计算机科学》
CSCD
北大核心
2013年第3期38-40,共3页
MapReduce任务负载均衡主要是通过分区函数来实现的,Hadoop默认的分区函数并不能很好地保证redu-cer的负载均衡。针对周期性的业务处理提出了一种基于权重计算的负载均衡策略,周期性任务的数据分布与历史数据相比具有相似性。本策略根...
MapReduce任务负载均衡主要是通过分区函数来实现的,Hadoop默认的分区函数并不能很好地保证redu-cer的负载均衡。针对周期性的业务处理提出了一种基于权重计算的负载均衡策略,周期性任务的数据分布与历史数据相比具有相似性。本策略根据历史数据运行的信息运算出数据权重信息(文中用权重表示每条记录的处理复杂度),再通过Map阶段抽样分析当前这批数据的分布特征来预测待处理数据带权重的整体近似分布情况,从而指导Reduce分区,以保证其负载均衡。通过简单的例子仿真了整个策略的运作过程,并且对比了与TeraSort思路的不同点。最后通过分析用户访问视频的日志证明了文中提到的策略比默认的策略性能提高了接近1倍。
展开更多
关键词
MAPREDUCE
terasort
负载均衡
周期性
在线阅读
下载PDF
职称材料
题名
MapReduce模型在大规模数据并行挖掘中的应用
被引量:
1
1
作者
唐婧
杜微
周翼
机构
常德职业技术学院
出处
《智能物联技术》
2024年第2期38-42,共5页
基金
2022年湖南省教育厅科学研究项目(22C0733)
2022年常德市科技局创新指导性计划项目(2022ZD04)。
文摘
MapReduce并行编程模型通过定义良好的接口和运行支持库,能够自动并行执行大规模计算任务,隐藏底层实现细节,降低并行编程的难度。系统阐述MapReduce的基本工作原理及其工作流程,以TeraSort算法为例,针对其存在的问题,提出动态数据分区和数据压缩等优化建议。研究成果表明,优化后的TeraSort算法能够显著缩短数据处理时间,优化系统的吞吐量,并改善资源分配的均衡性。
关键词
MAPREDUCE
大规模数据
并行挖掘
terasort
Keywords
MapReduce
large-scale data
parallel mining
terasort
分类号
TP311.5 [自动化与计算机技术—计算机软件与理论]
在线阅读
下载PDF
职称材料
题名
一种周期性MapReduce作业的负载均衡策略
被引量:
15
2
作者
傅杰
都志辉
机构
清华大学计算机科学与技术系
出处
《计算机科学》
CSCD
北大核心
2013年第3期38-40,共3页
基金
国家自然科学基金((61272087
61073008
+3 种基金
60773148
60503039)
北京市基金(4082016
4122039)资助
文摘
MapReduce任务负载均衡主要是通过分区函数来实现的,Hadoop默认的分区函数并不能很好地保证redu-cer的负载均衡。针对周期性的业务处理提出了一种基于权重计算的负载均衡策略,周期性任务的数据分布与历史数据相比具有相似性。本策略根据历史数据运行的信息运算出数据权重信息(文中用权重表示每条记录的处理复杂度),再通过Map阶段抽样分析当前这批数据的分布特征来预测待处理数据带权重的整体近似分布情况,从而指导Reduce分区,以保证其负载均衡。通过简单的例子仿真了整个策略的运作过程,并且对比了与TeraSort思路的不同点。最后通过分析用户访问视频的日志证明了文中提到的策略比默认的策略性能提高了接近1倍。
关键词
MAPREDUCE
terasort
负载均衡
周期性
Keywords
MapReduce,
terasort
, Load balance, Periodic
分类号
TP311.1 [自动化与计算机技术—计算机软件与理论]
在线阅读
下载PDF
职称材料
题名
作者
出处
发文年
被引量
操作
1
MapReduce模型在大规模数据并行挖掘中的应用
唐婧
杜微
周翼
《智能物联技术》
2024
1
在线阅读
下载PDF
职称材料
2
一种周期性MapReduce作业的负载均衡策略
傅杰
都志辉
《计算机科学》
CSCD
北大核心
2013
15
在线阅读
下载PDF
职称材料
已选择
0
条
导出题录
引用分析
参考文献
引证文献
统计分析
检索结果
已选文献
上一页
1
下一页
到第
页
确定
用户登录
登录
IP登录
使用帮助
返回顶部