什么是散列表（哈希表）-BENNYSNAKE-ChinaUnix博客

bigfish wikibigfishwiki.blog.chinaunix.net

首页　| 　博文目录　| 　关于我

BENNYSNAKE

博客访问： 3018811
博文数量： 401
博客积分： 12926
博客等级：上将
技术积分： 4588
用户组：普通用户
注册时间： 2009-02-22 14:51

文章分类

全部博文（401）

体系结构（1）
数字电路（1）
Games（2）
Shell（1）
英语学习（4）
线性代数（2）
MTD（1）
编译器链接器（0）
Linux USB（16）
mmc（0）
JAVA（2）
Android（35）
其他（4）
C/C++语言（24）
Embedded（31）
linux（210）
python（15）
tool（33）

git（8）
ARM（17）
未分配的博文（2）

文章存档

2015年（16）

2014年（4）

2013年（12）

2012年（82）

2011年（98）

2010年（112）

2009年（77）

我的朋友

相关博文

什么是散列表（哈希表）

分类： LINUX

2011-02-10 14:12:39

散列方法不同于顺序查找、二分查找、二叉排序树及B-树上的查找。它不以关键字的比较为基本操作，采用直接寻址技术。在理想情况下，无须任何比较就可以找到待查关键字，查找的期望时间为O(1)。

散列表的概念

1、散列表
    　设所有可能出现的关键字集合记为U(简称全集)。实际发生(即实际存储)的关键字集合记为K（|K|比|U|小得多）。
    　散列方法是使用函数h将U映射到表T[0..m-1]的下标上（m=O(|U|)）。这样以U中关键字为自变量，以h为函数的运算结果就是相应结点的存储地址。从而达到在O(1)时间内就可完成查找。
其中：
　    ① h：U→{0，1，2，…，m-1} ，通常称h为散列函数(Hash Function)。散列函数h的作用是压缩待处理的下标范围，使待处理的|U|个值减少到m个值，从而降低空间开销。
    　② T为散列表(Hash Table)。
    　③ h(K_i)(K_i∈U)是关键字为K_i结点存储地址(亦称散列值或散列地址)。
    　④ 将结点按其关键字的散列地址存储到散列表中的过程称为散列(Hashing)


3、散列表的冲突现象
（1）冲突
    　两个不同的关键字，由于散列函数值相同，因而被映射到同一表位置上。该现象称为冲突(Collision)或碰撞。发生冲突的两个关键字称为该散列函数的同义词(Synonym)。
　【例】上图中的k₂≠k₅，但h(k₂)=h(k₅)，故k₂和K₅所在的结点的存储地址相同。

（2）安全避免冲突的条件
    　最理想的解决冲突的方法是安全避免冲突。要做到这一点必须满足两个条件：
①其一是|U|≤m
②其二是选择合适的散列函数。
　    这只适用于|U|较小，且关键字均事先已知的情况，此时经过精心设计散列函数h有可能完全避免冲突。

（3）冲突不可能完全避免
    　通常情况下，h是一个压缩映像。虽然|K|≤m，但|U|>m，故无论怎样设计h，也不可能完全避免冲突。因此，只能在设计h时尽可能使冲突最少。同时还需要确定解决冲突的方法，使发生冲突的同义词能够存储到表中。

（4）影响冲突的因素
    　冲突的频繁程度除了与h相关外，还与表的填满程度相关。
    　设m和n分别表示表长和表中填人的结点数，则将α=n/m定义为散列表的装填因子(Load Factor)。α越大，表越满，冲突的机会也越大。通常取α≤1。

阅读(1715) | 评论(0) | 转发(0) |

上一篇：[转载]哈佛大学图书馆凌晨4点[自励共勉] (

下一篇：iozone 测试方法

给主人留下些什么吧！~~

感谢所有关心和支持过ChinaUnix的朋友们

16024965号-6