当前位置:首页 > 编程教程 > java技术文章 > 高级数据结构及应用之使用bitmap进行字符串去重的方法实例

用bitmap进行字符串去重的实例方法

  • 发布时间:
  • 作者:码农之家
  • 点击:65

这篇文章主要知识点是关于高级数据结构、bitmap、字符串去重、的内容,如果大家想对相关知识点有系统深入的学习,可以参阅以下电子书

图解数据结构:使用C++
  • 类型:数据结构大小:196 MB格式:PDF作者:胡昭民、吴灿铭
立即下载

高级数据结构及应用之使用bitmap进行字符串去重的方法实例

bitmap 即为由单个元素为 boolean(0/1, 0 表示未出现,1 表示已经出现过)的数组。

如果C/C++ 没有原生的 boolean 类型,可以用 int 或 char 来作为 bitmap 使用,如果我们要判断某字符(char)是否出现过

使用 int 作为 bitmap 的底层数据结构,bitmap 即为 int 数组,一个 int 长度为 32 个 bit 位,

  • c / 32 ⇒ bitmap 中的第几个 int
  • c % 32 ⇒ bitmap 中的某 int 中的第几个 bit 位;

使用 char 作为 bitmap 的底层数据结构,bitmap 即为 char 数组,一个 char 长度为 8 个 bit 位;

  • c / 8 ⇒ bitmap 中的第几个 char
  • c % 8 ⇒ bitmap 中某 char 中的第几个 bit 位;

ASCII

  • A-Z:65-90
  • a-z:97-122

如果使用 char 作为 bitmap 的替代底层数据结构,为了实现字符串的去重需要 char 的长度为多少呢?122/8+1 ⇒ 16。如果使用 int 作为 bitmap 的底层实现,则需要 int 数组的长度为 122/32 + 1 ⇒ 4

1. int 作为底层数据结构

void dedup(const char* src, char* dst)
{
  unsigned int exists[4] = { 0 };
  int i = 0, j = 0;
  unsigned int mask;
  char c;
  while (src[i])
  {
    c = src[i];
    mask = 1 << (c % 32);
    if ((exists[c / 32] & mask) == 0)
    {
      dst[j++] = c;
      exists[c / 32] |= mask;
    }
    i++;
  }
  dst[j] = '\0';
}

2. 使用 char 作为底层数据结构

void dedup(const char* src, char* dst)
{
  unsigned char exists[16] = { 0 };
  int i = 0, j = 0;
  unsigned int mask;
  char c;
  while (src[i])
  {
    c = src[i];
    mask = 1 << (c % 8);
    if ((exists[c / 8] & mask) == 0)
    {
      dst[j++] = c;
      exists[c / 8] |= mask;
    }
    i++;
  }
  dst[j] = '\0';
}

总结

以上就是这篇文章的全部内容了,希望本文的内容对大家的学习或者工作具有一定的参考学习价值,谢谢大家对码农之家的支持。如果你想了解更多相关内容请查看下面相关链接

以上就是本次给大家分享的关于java的全部知识点内容总结,大家还可以在下方相关文章里找到相关文章进一步学习,感谢大家的阅读和支持。

您可能感兴趣的文章:

  • Python对多属性的重复数据去重多种方法
  • python redis连接 有序集合去重的实例内容
  • 实现java8 list按照元素的某个字段去重的方法
  • 解决Pandas同元素多列去重问题
  • Java中连续重复字符去重方法
  • python opencv对目录下图片进行去重的技巧
  • 相关电子书
    学习笔记

    Copyright 2018-2020 www.xz577.com 码农之家

    版权投诉 / 书籍推广 / 赞助:520161757@qq.com