摘要
本发明公开了一种基于访问热度的数据迁移部署方法,本发明对于已迁移部署于分布式平台的列式数据集,根据其运行时用户访问日志信息,使用预测算法预测下一时段的访问量分布;根据预测得到的访问量分布计算出各个字段的访问次数排序;对预测访问次数最高的一列的字段的数据值的分布重新划分数据子区域,使得该字段的访问次数被均匀分配到新的数据子区域内;系统再根据访问次数最高的列重新划分的数据区域切分数据并在分布式平台上更新其数据部署。本发明结合用户对数据集的实际访问行为实现面向分布式平台的数据迁移部署,使得原始数据集访问热度最高列的访问热度被负载均衡到各个数据节点上,以实现数据集在分布式平台上的综合访问性能最佳。
- 单位