值得一看
双11 12
广告
广告

Python里hash函数原理 Python内置hash()函数的实现机制解析

hash()函数用于生成对象的哈希值,是基于对象内容计算出的整数,用于快速比较和查找。1.哈希值不是加密,而是整数标识;2.不同对象可能有相同哈希值,称为哈希冲突;3.只有不可变对象如整数、字符串、元组可被哈希;4.整数哈希值为其自身,字符串使用siphash算法计算;5.元组若包含不可哈希元素则不可哈希;6.自定义类需重写__hash__方法以支持哈希操作;7.hash值不唯一、不稳定且依赖环境设置。理解哈希机制有助于提升代码效率。

Python 中的 hash() 函数看起来简单,但背后其实涉及不少机制。它不是对对象“加密”或“摘要”,而是为对象生成一个整数,用来快速判断对象是否相等、用于字典和集合这类基于哈希表的数据结构中。

什么是 hash 值?

hash() 返回的是一个整数值,表示该对象的“哈希值”。这个值在对象生命周期内保持不变(前提是对象不可变),主要用于快速查找和比较。

比如:

>>> hash(10)
10
>>> hash("hello")
-9478562939069926921  # 这个数字可能每次运行都不一样,取决于 Python 的实现和环境

不同对象可能会有相同的哈希值,这叫“哈希冲突”,是正常现象。

立即学习“Python免费学习笔记(深入)”;


不同类型对象的 hash 实现方式不一样

Python 中并不是所有对象都能被 hash()。只有那些不可变的对象才支持哈希,比如整数、字符串、元组;而列表、字典这些可变对象则不能被哈希。

整数和浮点数

整数的哈希值就是它自己:

>>> hash(42)
42

浮点数的哈希值则稍复杂,但基本也是映射成一个固定的整数。

字符串

字符串的哈希值是根据内容计算出来的。Python 使用了一种叫做“SipHash”的算法(具体版本可能因 Python 版本和编译选项而异)来计算字符串的哈希值。这样做的目的是为了防止哈希碰撞攻击。

例如:

>>> hash("abc")
-123456789  # 每次运行结果可能不同(Python 启动时随机种子会影响)

注意:从 Python 3.3 开始,字符串的哈希值会受 PYTHONHASHSEED 环境变量影响,这是为了增加安全性。

元组

如果元组中的元素都是可哈希的,那么整个元组也是可哈希的:

>>> hash((1, 2, 3))
123456789

但如果元组里包含列表或其他不可哈希对象,调用 hash() 会报错:

>>> hash((1, [2, 3]))
TypeError: unhashable type: 'list'

自定义类的 hash 实现

如果你自定义了一个类,默认情况下它的实例是可哈希的(因为默认使用的是对象的 id)。但如果你重写了 __eq__ 方法,通常也应该同时重写 __hash__ 方法,否则你的对象在放入字典或集合中时会出现问题。

举个例子:

class Person:
def __init__(self, name):
self.name = name
def __eq__(self, other):
return self.name == other.name
def __hash__(self):
return hash(self.name)

这样你就可以把 Person 对象作为字典的键或者集合的元素了。


hash() 的局限性与注意事项

  • 不是加密:hash() 并不是为了安全设计的,不要用它来做密码哈希。
  • 值不唯一:不同的对象可能有相同的 hash 值,这就是哈希冲突。
  • 值不稳定:某些类型的 hash 值在每次 Python 启动时都可能变化(如字符串)。
  • 只适用于不可变对象:列表、字典这种可变对象不能被哈希。
  • 环境依赖:PYTHONHASHSEED 设置会影响字符串等类型的哈希值。

基本上就这些。理解 hash 的原理有助于写出更高效的代码,尤其是在使用字典、集合或自定义类的时候。

温馨提示: 本文最后更新于2025-06-07 22:30:49,某些文章具有时效性,若有错误或已失效,请在下方留言或联系易赚网
文章版权声明 1 本网站名称: 创客网
2 本站永久网址:https://new.ie310.com
1 本文采用非商业性使用-相同方式共享 4.0 国际许可协议[CC BY-NC-SA]进行授权
2 本站所有内容仅供参考,分享出来是为了可以给大家提供新的思路。
3 互联网转载资源会有一些其他联系方式,请大家不要盲目相信,被骗本站概不负责!
4 本网站只做项目揭秘,无法一对一教学指导,每篇文章内都含项目全套的教程讲解,请仔细阅读。
5 本站分享的所有平台仅供展示,本站不对平台真实性负责,站长建议大家自己根据项目关键词自己选择平台。
6 因为文章发布时间和您阅读文章时间存在时间差,所以有些项目红利期可能已经过了,能不能赚钱需要自己判断。
7 本网站仅做资源分享,不做任何收益保障,创业公司上收费几百上千的项目我免费分享出来的,希望大家可以认真学习。
8 本站所有资料均来自互联网公开分享,并不代表本站立场,如不慎侵犯到您的版权利益,请联系79283999@qq.com删除。

本站资料仅供学习交流使用请勿商业运营,严禁从事违法,侵权等任何非法活动,否则后果自负!
THE END
喜欢就支持一下吧
点赞13 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容