哈希表(hash table)
也叫散列表,是一种非常重要的数据结构,应用场景及其丰富,许多缓存技术(比如memcached)的核心其实就是在内存中维护一张大的哈希表,本文借鉴java中HashMap的实现,分析hash表的基本原理,并用Go语言进行实现。
一、什么是哈希表
在讨论哈希表之前,我们先大概了解下其他数据结构在新增,查找等基础操作执行性能
数组:采用一段连续的存储单元来存储数据。对于指定下标的查找,时间复杂度为O(1);通过给定值进行查找,需要遍历数组,逐一比对给定关键字和数组元素,时间复杂度为O(n),当然,对于有序数组,则可采用二分查找,插值查找,斐波那契查找等方式,可将查找复杂度提高为O(logn);对于一般的插入删除操作,涉及到数组元素的移动,其平均复杂度也为O(n)
线性链表:对于链表的新增,删除等操作(在找到指定操作位置后),仅需处理结点间的引用即可,时间复杂度为O(1),而查找操作需要遍历链表逐一进行比对,复杂度为O(n)
二叉树:对一棵相对平衡的有序二叉树,对其进行插入,查找,删除等操作,平均复杂度均为O(logn)。
哈希表:相比上述几种数据结构,在哈希表中进行添加,删除,查找等操作,性能十分之高,不考虑哈希冲突的情况下(后面会探讨下哈希冲突的情况),仅需一次定位即可完成,时间复杂度为O(1),接下来我们就来看看哈希表是如何实现达到惊艳的常数阶O(1)的。
我们知道,数据结构的物理存储结构只有两种:顺序存储结构和链式存储结构(像栈,队列,树,图等是从逻辑结构去抽象的,映射到内存中,也这两种物理组织形式),而在上面我们提到过,在数组中根据下标查找某个元素,一次定位就可以达到,哈希表利用了这种特性,哈希表的主干就是数组。
比如我们要新增或查找某个元素,我们通过把当前元素的关键字 通过某个函数映射到数组中的某个位置,通过数组下标一次定位就可完成操作。
这个函数可以简单描述为:存储位置 = f(关键字) ,这个函数f一般称为哈希函数,这个函数的设计好坏会直接影响到哈希表的优劣。举个例子,比如我们要在哈希表中执行插入操作:
插入过程如下图所示
查找操作同理,先通过哈希函数计算出实际存储地址,然后从数组中对应地址取出即可。
哈希冲突
然而万事无完美,如果两个不同的元素,通过哈希函数得出的实际存储地址相同怎么办?也就是说,当我们对某个元素进行哈希运算,得到一个存储地址,然后要进行插入的时候,发现已经被其他元素占用了,其实这就是所谓的哈希冲突,也叫哈希碰撞。前面我们提到过,哈希函数的设计至关重要,好的哈希函数会尽可能地保证 计算简单和散列地址分布均匀,但是,我们需要清楚的是,数组是一块连续的固定长度的内存空间,再好的哈希函数也不能保证得到的存储地址绝对不发生冲突。那么哈希冲突如何解决呢?哈希冲突的解决方案有多种:开放定址法(发生冲突,继续寻找下一块未被占用的存储地址),再散列函数法,链地址法,而HashMap即是采用了链地址法,也就是数组+链表的方式。
Go语言实现代码:
linkedNodes部分:
package gohash import "fmt" //Map 定义一个map结构type Map struct { k string v string} //Node 链表节点type Node struct { data Map next *Node} //CreatHeadNode 创建头节点func creatHeadNode(k, v string) *Node { //创建头节点 node := new(Node) node.data.k = k node.data.v = v node.next = nil /* //头指针和当前指针指向头节点 Head = node Curr = node */ return node //返回node,作为hashmap数组中的头节点} //AddNode 新增节点func addNode(k, v string, Curr *Node) { node := new(Node) node.data.k = k node.data.v = v node.next = nil //挂接节点 Curr.next = node //Curr = node} //PrintNode 遍历打印节点func printNode(head *Node) { p := head for { if p.next == nil { fmt.Printf("%s:%s", p.data.k, p.data.v) return } fmt.Printf("%s:%s->", p.data.k, p.data.v) p = p.next }} //CntNodes 计算节点个数func cntNodes(head *Node) int { cnt := 0 p := head //若链表为空 if p == nil { return cnt } //若不为空 for { if p.next == nil { cnt++ return cnt } cnt++ p = p.next }}
hashMap部分:
package gohash import "fmt" //HashArr 定义一个nodes的数组var hashArr [16]*Node //[<nil> <nil> <nil> <nil> <nil> <nil> <nil> <nil> <nil> <nil> <nil> <nil> <nil> <nil> <nil> <nil>] //PutData put valuefunc PutData(k, v string) { var pos = hashCode(k) //判断要插入的数组位置是否为空 if hashArr[pos] == nil { //直接在hashArr[pos]中插入数据 hashArr[pos] = creatHeadNode(k, v) return } //若不为空,遍历到该链表末尾指针位置 curr := getTail(hashArr[pos]) //插入末尾 addNode(k, v, curr) return} //Get get valuefunc Get(k string) (string, bool) { pos := hashCode(k) p := hashArr[pos] for { if p == nil { return "", false } if p.data.k == k { return p.data.v, true } p = p.next }} //GetAll 打印整个hashmapfunc GetAll() { for i := 0; i < 16; i++ { if hashArr[i] == nil { fmt.Printf("%d: \n", i) } else { fmt.Printf("%d: ", i) printNode(hashArr[i]) fmt.Printf("\n") } }} //GetTail 找到末尾指针func getTail(head *Node) *Node { p := head for { if p.next == nil { return p } p = p.next }} //HashCode 将key转换成数组下标的散列算法,范围16之间func hashCode(key string) int { var index int = 0 index = int(key[0]) for k := 0; k < len(key); k++ { index *= (1103515245 + int(key[k])) } index >>= 27 index &= 16 - 1 return index}
测试:
package main import ( "fmt" "github.com/LeZeJ/Day6/gohash") func main() { gohash.PutData("1", "a") gohash.PutData("2", "b") gohash.PutData("3", "c") gohash.PutData("4", "d") gohash.PutData("5", "e") gohash.PutData("6", "f") gohash.PutData("7", "g") gohash.PutData("8", "h") gohash.PutData("9", "i") gohash.PutData("10", "j") gohash.PutData("11", "k") gohash.PutData("12", "l") gohash.PutData("13", "m") gohash.PutData("14", "n") gohash.PutData("15", "o") gohash.PutData("16", "p") gohash.PutData("17", "q") gohash.PutData("18", "r") v, _ := gohash.Get("3") v1, _ := gohash.Get("8") fmt.Println(v) fmt.Println(v1) gohash.GetAll()}
运行结果:
ch0:1: 11:k2: 1:a->17:q3: 3:c->5:e4: 7:g->9:i->12:l5: 18:r6:7: 13:m8:9: 14:n10:11: 2:b->4:d->6:f12: 8:h->15:o13:14: 10:j15: 16:p
原网址: 访问
创建于: 2022-08-23 15:30:02
目录: default
标签: 无
未标明原创文章均为采集,版权归作者所有,转载无需和我联系,请注明原出处,南摩阿彌陀佛,知识,不只知道,要得到
java windows火焰图_mob64ca12ec8020的技术博客_51CTO博客 - 在windows下不可行,不知道作者是怎样搞的 监听SpringBoot 服务启动成功事件并打印信息_监听springboot启动完毕-CSDN博客 SpringBoot中就绪探针和存活探针_management.endpoint.health.probes.enabled-CSDN博客 u2u转换板 - 嘉立创EDA开源硬件平台 Spring Boot 项目的轻量级 HTTP 客户端 retrofit 框架,快来试试它!_Java精选-CSDN博客 手把手教你打造一套最牛的知识笔记管理系统! - 知乎 - 想法有重合-理论可参考 安宇雨 闲鱼 机械键盘 客制化 开贴记录 文本 linux 使用find命令查找包含某字符串的文件_beijihukk的博客-CSDN博客_find 查找字符串 ---- mac 也适用 安宇雨 打字音 记录集合 B站 bilibili 自行搭建 开坑 真正的客制化 安宇雨 黑苹果开坑 查找工具包maven pom 引用地 工具网站 Dantelis 介绍的玩轴入坑攻略 --- 关于轴的一些说法 --- 非官方 ---- 心得而已 --- 长期开坑更新 [本人问题][新开坑位]关于自动化测试的工具与平台应用 机械键盘 开团 网站记录 -- 能做一个收集的程序就好了 不过现在没时间 -- 信息大多是在群里发的 - 你要让垃圾佬 都去一个地方看难度也是很大的 精神支柱 [超级前台]sprinbboot maven superdesk-app 记录 [信息有用] [环境准备] [基本完成] [sebp/elk] 给已创建的Docker容器增加新的端口映射 - qq_30599553的博客 - CSDN博客 [正在研究] Elasticsearch, Logstash, Kibana (ELK) Docker image documentation elasticsearch centos 安装记录 及 启动手记 正式服务器 39 elasticsearch 问题合集 不断更新 6.1.1 | 6.5.1 两个版本 博客程序 - 测试 - bug记录 等等问题 laravel的启动过程解析 - lpfuture - 博客园 OAuth2 Server PHP 用 Laravel 搭建带 OAuth2 验证的 RESTful 服务 | Laravel China 社区 - 高品质的 Laravel 和 PHP 开发者社区 利用Laravel 搭建oauth2 API接口 附 Unauthenticated 解决办法 - 煮茶的博客 - SegmentFault 思否 使用 OAuth2-Server-php 搭建 OAuth2 Server - 午时的海 - 博客园 基于PHP构建OAuth 2.0 服务端 认证平台 - Endv - 博客园 Laravel 的 Artisan 命令行工具 Laravel 的文件系统和云存储功能集成 浅谈Chromium中的设计模式--终--Observer模式 浅谈Chromium中的设计模式--二--pre/post和Delegate模式 浅谈Chromium中的设计模式--一--Chromium中模块分层和进程模型 DeepMind 4 Hacking Yourself README.md update 20211011
Laravel China 简书 知乎 博客园 CSDN博客 开源中国 Go Further Ryan是菜鸟 | LNMP技术栈笔记 云栖社区-阿里云 Netflix技术博客 Techie Delight Linkedin技术博客 Dropbox技术博客 Facebook技术博客 淘宝中间件团队 美团技术博客 360技术博客 古巷博客 - 一个专注于分享的不正常博客 软件测试知识传播 - 测试窝 有赞技术团队 阮一峰 语雀 静觅丨崔庆才的个人博客 软件测试从业者综合能力提升 - isTester IBM Java 开发 使用开放 Java 生态系统开发现代应用程序 pengdai 一个强大的博主 HTML5资源教程 | 分享HTML5开发资源和开发教程 蘑菇博客 - 专注于技术分享的博客平台 个人博客-leapMie 流星007 CSDN博客 - 舍其小伙伴 稀土掘金 Go 技术论坛 | Golang / Go 语言中国知识社区
最新评论