基于压缩-字对齐位图的天文海量数据实时索引  被引量:1

Massive astronomical real-time data indexing based on compressed word-aligned bitmap

在线阅读下载全文

作  者:刘应波[1,2] 王锋[1,3,2] 季凯帆[3] 邓辉[3] 戴伟[1,3,2] 梁波[3] 

机构地区:[1]中国科学院云南天文台,昆明650011 [2]中国科学院大学,北京100049 [3]昆明理工大学云南省计算机技术应用重点实验室,昆明650500

出  处:《计算机工程与应用》2016年第1期37-41,140,共6页Computer Engineering and Applications

基  金:国家自然科学基金(No.U1231205,No.11263004,No.11163004,No.11103005);云南省应用基础研究基金重点项目(No.2013FA013,No.2013FA032)

摘  要:澄江一米新真空大型天文望远镜(NVST)当前每天最大能产生2 TB,约十多万条的观测数据。由于这些数据量巨大并具有非结构化特性,使用离线构建索引会带来巨大时间开销,传统的关系型数据库难以满足快速索引和检索需求。针对这些问题,结合数据采集流程,提出了使用基于压缩的字对齐位图索引算法来在线实时构建索引。这种方式不仅克服了离线构建索引方式时,文件访问、FITS头读取和解析FITS头等操作带来的大量额外时间消耗问题,而且有助于解决海量太阳观测数据的高效检索难题。通过实验证明了在线实时构建索引方式能够极大地降低时间开销,也表明了该方式在天文海量数据索引和检索应用中的有效性和可行性。At present, New Vacuum Solar Telescope(NVST)is generating data more than 2 TB per day, and due to the characteristic of massive non-structure data, it is beyond traditional database systems to search efficiently for a subset of these extremely large with low latency and response time and time overtime is increasing by the way of off-line index building. Aiming at these problems, combined with the strategy of on-line real data indexing in observation data capture system, using an approach of the compressed word-aligned bitmap index for observation data indexing and querying is proposed. This approach cannot only save the time cost of accessing FITS file, reading FITS file header and parsing header keyword in off-line indexing mode, but also can solve the problem of massive solar data retrieval. Experiments show that time overhead can be reduced by using real-time data indexing, and the effectiveness and feasibility of the method are proved in the experiments.

关 键 词:字对齐位图索引 FastBit 海量数据 大型望远镜 

分 类 号:TP39[自动化与计算机技术—计算机应用技术]

 

参考文献:

正在载入数据...

 

二级参考文献:

正在载入数据...

 

耦合文献:

正在载入数据...

 

引证文献:

正在载入数据...

 

二级引证文献:

正在载入数据...

 

同被引文献:

正在载入数据...

 

相关期刊文献:

正在载入数据...

相关的主题
相关的作者对象
相关的机构对象