百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 编程网 > 正文

生成分布式全局唯一ID常见的几种方案

yuyutoo 2024-10-18 12:12 1 浏览 0 评论

分布式系统中全局唯一id是我们经常用到的,生成全局id方法由很多,我们选择的时候也比较纠结。每种方式都有各自的使用场景,如果我们熟悉各种方式及优缺点,结合自身的业务,使用的时候才能更好的选择。


本文主要讨论

1、常见的生成全局唯一id有哪些?
2、他们各有什么优缺点?

下面我们就一起来看一下常见的生成全局唯一id的方法


1. 使用数据库自动增长序列实现

使用数据库的自动增长来实现,算是常见最简单的解决方案,数据库内部可以确保生成id的唯一性。

优点:
1)实现简单
2)id是有序的,对于有排序需求的比较有利

缺点:
1)依赖于数据库数据插入,性能比较低
2)对数据库有依赖,每种数据库可能实现不一样,数据库切换时候,涉及到代码的修改,不利于扩展


2. 使用UUID实现

也是比较常见的解决方案,uuid全球唯一。

优点:
1)代码简单
2)性能比较好
3)对其他无依赖,方便扩展

缺点:
1)uuid是一段很长的字符,没有排序的,无法保证按顺序递增
2)uuid比较长,存储在数据库中占用的空间也比较大,不利于检索和排序
3)生成的数据比较长,数据量大的情况下,对传输效率也会有影响


3. 使用redis实现

我们可以使用redis的原子操作 INCR和INCRBY来实现,redis性能也比较高,若单机存在性能瓶颈,无法满足业务需求,可以采用集群的方式来实现。

多个集群之间增加步长来避免生成id重复的问题,如有5台redis:
第1台生成:1、6、11、16
第2台生成:2、7、12、17
第3台生成:3、8、13、18
第4台生成:4、9、14、19
第5台生成:5、10、15、20

redis重启的时候,数据可能会丢失,可以在生成的id前面加上一个时间戳来做到唯一性。

优点:
1)性能比较高
2)生成的数据是有序的,对排序业务有利

缺点:
1)依赖于redis,需要系统引进redis组件,增加了系统的复杂性


4. 使用Twitter的snowflake算法实现

这个是twitter的一个全局唯一id生成器,结果是一个long型的ID。其核心思想是:使用41bit作为毫秒数,10bit作为机器的ID(5个bit是数据中心,5个bit的机器ID),12bit作为毫秒内的流水号(意味着每个节点在每毫秒可以产生 4096 个 ID),最后还有一个符号位,永远是0。具体实现的代码可以参看https://github.com/twitter/snowflake


5. 使用数据库+本地缓存实现高效ID生成器

数据库中存储一个数字类型的字段cur_value,初始化为0,我们每次可以申请n个数字,然后将数据缓存在本地,使用时直接从缓存中获取。

过程:
1)创建表

CREATE TABLE `yjd_id_generator` (
  `id` bigint(20) NOT NULL AUTO_INCREMENT COMMENT '编号',
  `code` varchar(64) NOT NULL DEFAULT '' COMMENT '编码',
  `cur_value` bigint(20) NOT NULL DEFAULT '1' COMMENT '当前值',
  `description` varchar(128) NOT NULL DEFAULT '' COMMENT '说明',
  PRIMARY KEY (`id`),
  UNIQUE KEY `idx_uq_code` (`code`)
) ENGINE=InnoDB AUTO_INCREMENT=24 DEFAULT CHARSET=utf8 COMMENT='id生成器,cur_value每次递增一定的范围'

cur_value记录当前已申请到的最大值。

2) 通过code查询表yjd_id_generator中的记录,将cur_value更新为cur_value+n,更新成功,表示(cur_value,n]范围内的数字我们申请成功,可以使用。存在一个并发问题,需要避免多个线程同时更新的问题,我们可以通过使用cur_value作为条件进行更新,即采用乐观锁的方式进行更新,如果更新成功,表示申请成功,假如查询的cur_value值为100,那么在cur_value上递增100,此时cur_value = 200,执行如下更新操作:

update yjd_id_generator set cur_value = 200 where code = '业务编码’ and cur_value = 100;

若上面的sql执行成功,表示更新成功,上面通过乐观锁保证了并发情况下只有一个请求会执行成功。如果更新失败,表示cur_value被其他线程更新了,需要重复获取记录继续执行更新操作,类似于java中的cas操作。

4) 把生成好的id放在本地内存缓存队列中给系统使用,效率也是非常高的。

5) 原码可以点击底部"阅读原文"


优点:
1)性能比较高
2)生成的数据是有序的,对排序业务有利

缺点:
1)依赖于数据库


总结

本文介绍了5中方式供大家选择,大家如果有其他方式可以分享交流。


【转发一下然后再关注我私信回复“全套资料”可以得到获取架构资料方式哦!】

相关推荐

Google Chrome 100 Beta发布 用户代理字符串作用开始逐渐降低

GoogleChrome和MozillaFirefox都在迅速接近100版本,这有可能破坏一些错误识别浏览器版本的网站(可能导致访问不正常,这有点类似于众所周知的千年虫)。两种浏览器都在研究可能的...

如何在Chrome,Edge,Safari和Firefox中更改用户代理

无论您是SEO,营销人员还是Web开发人员,通常都可能需要更改浏览器的用户代理以测试其他内容。例如,您正在运行特定于MAC-OS的活动。要确定您的广告系列是否正常运行并且未针对Linux用户,更改浏览...

Mozilla正在测试新的浏览器UserAgent

Mozilla最近发布了一个实验项目来测试3位数的UserAgent版本“Firefox/100.0”会不会让一些网站停止正常工作。浏览器UserAgent是一串字符串,里面包含了浏览器的软件信息,版...

爬虫与User-Agent

什么是User-Agent呢?User-Agent是一个特殊字符串头,被广泛用来标示浏览器客户端的信息,使得服务器能识别客户机使用的操作系统和版本,CPU类型,浏览器及版本,浏览器的渲染引擎,浏览器...

让你的浏览器充满魔性——User Agent Switche

对于前端人员,闲暇时就会研究各种插件,今天我就分享UserAgentSwitcher在Firefox和Chrome的使用情况。一、Firefox浏览器UserAgentSwitcher作为火...

亚马逊账号运营安全-浏览器指纹识别之User-Agent开篇

UA包含了一个约定的特征字符串。主要是面向受访问网络表明自己的操作系统,软件开发商,版本,应用类型等信息。这是一种主动暴露信息的方式。我们来看关于UA的简单语法定义:User-Agent:<p...

【每日学习】Python爬虫之伪装浏览器User-Agent

【主题】Python爬虫之伪装浏览器原理【分析】1.创建自定义请求对象的目的,对抗网站的反爬虫机制2.反爬虫机制1:判断用户是否是浏览器访问(User-Agent)3.对抗措施1:伪装浏览器进行访问【...

亚马逊账号运营安全-浏览器指纹识别之User-Agent二篇

大家好,上一篇亚马逊账号运营安全-浏览器指纹识别之User-Agent开篇为大家阐述了原理。下面是作者为大家整理的其他几个主流浏览器的UA配置。一下都是Windows1064X系统下整理。Chrom...

常见的爬虫UserAgent

通过前面的文章我们知道,UserAgent(用户代理)是HTTP请求的一部分,用于告诉服务器发起请求的客户端类型和属性等信息。同时,也了解了常见的UserAgent。...

HTTP请求头之User-Agent

什么是User-AgentUser-Agent中文名为用户代理,简称UA,...

你想不到的浏览器流氓史!那些奇怪的User-Agent,是这么来的...

平时我们用chrome浏览器做开发测试。Chrome的Useragent字段怎么这么奇怪?...

谷歌宣布 Chrome 将逐步停止支持 User Agent

谷歌近日宣布将放弃对Chrome浏览器中用户代理字符串(User-AgentString)的支持。取而代之的是,Chrome将提供一个名为“客户端提示(ClientHints)”的新API...

数据采集-用户代理(useragent)

UserAgent分类:PC端的UserAgent。移动端UserAgent。使用UserAgent的必要性:在写python网络爬虫程序的时候,经常需要修改UserAgent,有很多原因,罗列几个如...

如何获取当前浏览器的useragent

有时候,我们需要得到浏览器的useragent,从而再进行后面的一系列判断,返回不同的值。网上有说,在浏览器地址栏输入:javascript:alert(navigator.userAgent)这种方...

User Agent 解析:它是什么以及如何修改

什么是UserAgent?UserAgent,简称UA,是一个使服务器能够识别用户使用的浏览器类型、版本以及运行浏览器的操作系统等信息的字符串。它作为浏览器请求头部信息的一部分发送给服务器,以便服务...

取消回复欢迎 发表评论: