FM-index算法加速压缩文件字符串查找的性能测试及并行化初探.pdfVIP

  • 71
  • 0
  • 约1.42万字
  • 约 5页
  • 2015-09-06 发布于安徽
  • 举报

FM-index算法加速压缩文件字符串查找的性能测试及并行化初探.pdf

并行计算 11 依然是不太合适的。 把字符串从压缩格式还原为原始字符串。前向 如何将压缩和索引技术组合起来现在受到了 BWT由三步组成:(1)在字符串T的末尾增加一个 越来越多的关注,特别是在基于词的索引的情况 特殊的字符#,这个字符比文本里的任何字符都 下,在空间占用和查询性能之间正在取得一个试 小;(2)形成一个概念矩阵M,每一行的内容是首 验性的平衡结果。目前已经有人提出了对索引数 先对字符串T#的循环移位,然后把每一行看成一 据结构的直接压缩的想法,发掘LZ压缩的特性来 个单词,对这些单词进行字典排序后形成矩阵; 减少索引点的数量,仍然支持模式搜索。 (3)取出M的最后一列构成转换后的字符串L。注意 M的每一列是最后一列L的重新排列,并且M的第 FM—index基于BW压缩算法|1l和后缀数组数 据结构I引。由于后缀指针的“明显随机”

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档