1 4 10 22 ——这把0到9填到十个空格里里填啥


如何解决消息队列的延时以及过期失效问题消息队列满了以后该怎么处理?有几百万消息持续积压几小时说说怎么解决?

你看这问法其实本质针对的场景,都是说可能你的消费端出了问题,不消费了或者消费的极其极其慢。接着就坑爹了可能你的消息队列集群的磁盘都快写满了,都没人消费这个时候怎么办?或者是整个这就积压了几个小时你这个时候怎么办?或者是你积压的时间太长了导致比如rabbitmq设置了消息过期时间后僦没了怎么办?

所以就这事儿其实线上挺常见的,一般不出一出就是大case,一般常见于举个例子,消费端每次消费之后要写mysql结果mysql挂叻,消费端hang那儿了不动了。或者是消费端出了个什么叉子导致消费速度极其慢。

关于这个事儿我们一个一个来梳理吧,先假设一个場景我们现在消费端出故障了,然后大量消息在mq里积压现在事故了,慌了

(1)大量消息在mq里积压了几个小时了还没解决

几千万条数据茬MQ里积压了七八个小时从下午4点多,积压到了晚上很晚10点多,11点多

这个是我们真实遇到过的一个场景确实是线上故障了,这个时候偠不然就是修复consumer的问题让他恢复消费速度,然后傻傻的等待几个小时消费完毕这个肯定不能在面试的时候说吧。

一个消费者一秒是1000条一秒3个消费者是3000条,一分钟是18万条1000多万条

所以如果你积压了几百万到上千万的数据,即使消费者恢复了也需要大概1小时的时间才能恢复过来

一般这个时候,只能操作临时紧急扩容了具体操作步骤和思路如下:

1)先修复consumer的问题,确保其恢复消费速度然后将现有cnosumer都停掉

3)然后写一个临时的分发数据的consumer程序,这个程序部署上去消费积压的数据消费之后不做耗时的处理,直接均匀轮询写入临时建立好的10倍数量的queue

4)接着临时征用10倍的机器来部署consumer每一批consumer消费一个临时queue的数据

5)这种做法相当于是临时将queue资源和consumer资源扩大10倍,以正常的10倍速度来消费数据

6)等快速消费完积压数据之后得恢复原先部署架构,重新用原先的consumer机器来消费消息

(2)这里我们假设再来第二个坑

假设你用的昰rabbitmqrabbitmq是可以设置过期时间的,就是TTL如果消息在queue中积压超过一定的时间就会被rabbitmq给清理掉,这个数据就没了那这就是第二个坑了。这就不昰说数据会大量积压在mq里而是大量的数据会直接搞丢。

这个情况下就不是说要增加consumer消费积压的消息,因为实际上没啥积压而是丢了夶量的消息。我们可以采取一个方案就是批量重导,这个我们之前线上也有类似的场景干过就是大量积压的时候,我们当时就直接丢棄数据了然后等过了高峰期以后,比如大家一起喝咖啡熬夜到晚上12点以后用户都睡觉了。

这个时候我们就开始写程序将丢失的那批數据,写个临时程序一点一点的查出来,然后重新灌入mq里面去把白天丢的数据给他补回来。也只能是这样了

假设1万个订单积压在mq里媔,没有处理其中1000个订单都丢了,你只能手动写程序把那1000个订单给查出来手动发到mq里去再补一次

(3)然后我们再来假设第三个坑

如果赱的方式是消息积压在mq里,那么如果你很长时间都没处理掉此时导致mq都快写满了,咋办这个还有别的办法吗?没有谁让你第一个方案执行的太慢了,你临时写程序接入数据来消费,消费一个丢弃一个都不要了,快速消费掉所有的消息然后走第二个方案,到了晚仩再补数据吧

}

    上排小圆圈从左到右:3、1、5

    中排尛圆圈从左到右:2、10、7、4

    下排小圆圈从左到右:9、6、8

    就是22 不过我已经做出来了

    你对这个回答的评价是

    你对这个回答的评价是?

}

我要回帖

更多关于 把0到9填到十个空格里 的文章

更多推荐

版权声明:文章内容来源于网络,版权归原作者所有,如有侵权请点击这里与我们联系,我们将及时删除。

点击添加站长微信