目录

  1. 什么是redis?
  2. redis的数据类型
  3. 使用redis有哪些好处
  4. redis相比memcached有哪些区别
  5. redis相比memcached有哪些优势
  6. redis是单进程单线程的?
  7. 一个字符串类型的值能存储的最大容量是多少
  8. redis的持久化机制是什么?各自的优缺点
  9. redis常见性能问题和解决方案
  10. redis过期键的删除策略
  11. redis的回收策略(淘汰策略)
  12. 为什么redis需要把所有的数据放到内存中
  13. redis的同步机制是什么
  14. pipeline有什么好处,为什么要用pipeline
  15. 是否使用过redis集群,集群的原理是什么
  16. redis集群方案什么情况下会导致集群不可用
  17. redis支持的java客户端有哪些?官方推荐用哪个
  18. jedis与redisson对比有什么优缺点?
  19. redis如何设置密码以及验证密码
  20. 说说redis哈希槽的概念
  21. redis集群的主从模型是怎样的
  22. redis集群会有写操作丢失吗,为什么
  23. redis集群之间是如何复制的
  24. redis集群最大节点个数是多少
  25. redis集群如何选择数据库
  26. 怎么测试redis的连通性
  27. 怎么理解redis的事务
  28. redis事务相关的命令有哪几个
  29. redis key 的过期时间和永久有效分别如何设置
  30. redis如何做内存优化
  31. redis回收进程如何工作
  32. 都有哪些办法可以降低redis的内存使用情况
  33. redis的内存用完了会发生什么
  34. 一个redis实例最多能存放多少的keys?list、set、sorted set 它们最多都能存放多少元素
  35. mysql里有2000w数据,redis中只存20w数据,如何保证redis中的数据都是热点数据?redis内存数据集大小上升到一定大小的时候,就会实行数据淘汰策略
  36. redis最适合的场景
  37. 加入redis内有一亿个key,其中有10w个key是以某个固定的已知前缀开头的,如何将它们全部找出来?
  38. 如果有大量的key需要设置同一过期时间,一般需要注意什么?
  39. 使用过redis做异步队列吗?你是怎么用的
  40. 使用过redis分布式锁吗,它是怎么回事


Redis

什么是redis?

redis是完全开源免费的,遵守BSD协议,是一个高性能的key-value数据库。
redis与其他key-value缓存产品有以下三个特点

  • redis支持数据持久化,可以将内存中的数据保存在磁盘中,重启的时候可以再次加载进行使用
  • redis不仅仅支持简单的key-value类型的数据,同时还提供list、set、zset、hash等数据结构的存储
  • redis支持数据的备份,即master-slave模式的数据备份

redis的优势

  • 性能极高 — redis能读的速度是110000次/s,写的速度是81000次/s
  • 丰富的数据类型 — redis支持二进制案例的Strings、Lists、Hashes、Sets及Ordered Sets数据类型操作
  • 原子 — redis的所有操作都是原子性的,意思就是要么成功执行,要么失败完全不执行。单个操作是原子性的。多个操作也支持事务,即原子性,通过Multi和Exec指令包起来
  • 丰富的特性 — redis还支持publish/subscribe,通知,key过期等特性

redis与其他key-value存储有什么不同?

  • 原子性
  • 持久化

    redis的数据类型

    redis支持五种数据类型:
  1. string(字符串)
  2. hash(哈希)
  3. list(列表)
  4. set(集合)
  5. zset -> sorted set(有序集合)

比较常用的是string、hash,如果你是redis中高级用户,还需要加上下面几种数据结构:

  • HyperLogLog?
  • Geo
  • Pub/Sub

如果你说还玩过Redis Module,像BloomFilter、RedisSearch、Redis-ML,面试官的眼睛就开始发亮了

使用redis有哪些好处

  • 速度快,因为数据是在内存中,类似于HashMap,HashMap的优势就是查找和操作的时间复杂度都是O(1)
  • 支持丰富数据类型,支持string、list、set、zset、hash等
  • 支持事务,操作都是原子性,所谓的原子性就是对数据的更改要么全部执行,要么全部不执行
  • 丰富的特性:可用于缓存、消息、按key设置过期事件,过期后会自动删除

    redis相比memcached有哪些区别

    存储方式

  • Memcache把所有数据全部存在内存之中,断电之后会挂掉,数据不能超过内存大小。redis有部分存在硬盘上,这样能保证数据的持久性

支持类型

  • Memcache对数据类型支持相对简单。redis有复杂的数据类型

底层模型

  • 他们之间底层实现方式,以及与客户端之间通信的应用协议不一样。redis直接自己构建了VM机制,因为一般的系统调用函数会浪费一定的时间去移动与请求。

    redis相比memcached有哪些优势

  • Memcache所有的值均是简单的字符串,redis作为其替代者,支持更为丰富的数据类型

  • redis的速度比memcache快很多
  • redis可以支持数据持久化

    redis是单进程单线程的?

    redis是单线程单进程的,redis利用队列技术将并发访问变为串行访问,消除了传统数据库串行控制的开销

    一个字符串类型的值能存储的最大容量是多少

    512M

    redis的持久化机制是什么?各自的优缺点

    redis提供两种持久化机制,RDB和AOF机制:

  • RDB(redis database):是指用数据集快照的方式半持久化,记录redis数据库的所有键值对,在某个时间点将数据写入一个临时文件,持久化结束后,用这个临时文件替换上次持久化的文件,达到数据恢复。

    • 优点:
      • 只有一个文件dump.rdb,方便持久化
      • 容灾性好,一个文件可以保存到安全的磁盘
      • 性能最大化,fork子进程来完成写操作,让主进程继续处理命令,所以是IO最大化。使用单独子进程进行持久化,主进程不会进行任何IO操作,保存了redis的高性能
      • 相对于数据集大时,比AOF的气动效率更高
    • 缺点:
      • 数据安全性低。RDB时间隔一段时间进行持久化,如果持久化之间redis发生故障,会发生数据丢失。所以这种方式更适合数据要求不严谨的时候
  • AOF(append-only file):是指所有的命令行记录以redis命令请求协议的格式完全持久化存储,保存为aof文件
    • 优点:
      • 数据安全,aof持久化可以配置appendfsync属性,有always,每进行一次命令操作就记录到aof文件中一次。
      • 通过append模式写文件,即使中途服务器宕机,可以通过redis-check-aof工具解决数据一致性问题
      • aof机制的rewrite模式。aof文件没被rewrite之前(文件过大时会对命令进行合并重写),可以删除其中的某些命令(比如误操作的flushall)
    • 缺点:
      • aof文件比rdb大,且回复速度慢
      • 数据集大的时候,比rdb启动效率低

        redis常见性能问题和解决方案*

  1. master最好不要写内存快照,如果master写内存快照,save命令调度rdbSave函数,会阻塞主线程的工作,当快照比较大的时候对性能影响是非常大的,会间断性暂停服务。
  2. 如果数据比较重要,某个slave开启aof备份数据,策略设置为每秒同步一次
  3. 为了主从复制的速度和连接的稳定性,master和slave最好在同一个局域网
  4. 尽量避免在压力很大的主库上增加从??
  5. 主从复制不要用图状结构,用单向链表结构更为稳定,即:master<-slave1<-slave2<-slave3…,这样的结构可以方面解决单点故障问题,实现slave对master的替换。如果master挂掉,可以立刻启用slave1做master,其他不变。

    redis过期键的删除策略

  6. 定时删除:在设置键的过期事件的同时,创建一个定时器(timer),让定时器在键的过期时间到来时,立刻对键进行删除操作。

  7. 惰性删除:放任键过期不管,但是每次从键空间中获取键时,都检查取得的键是否过期,如果过期的话,就删除该键;如果没有过期,就返回该键。
  8. 定期删除:每隔一段时间程序就对数据库进行一次检查,删除里面过期的键。至于要删除多少过期键,以及要检查多少个数据库,则由算法决定

    redis的回收策略(淘汰策略)

  • volatile-lru:从已设置过期时间的数据集(server.db[i].expires)中挑选最近最少使用的数据淘汰
  • volatile-ttl:从已设置过期时间的数据集(server.db[i].expires)中挑选将要过期的数据淘汰
  • volatile-random:从已设置过期时间的数据集(server.db[i].expires)中任选数据淘汰
  • allkeys-lru:从数据集(server.db[i].dict)中挑选最近最少使用的数据淘汰
  • allkeys-random:从数据集(server.db[i].dict)中任意选择数据淘汰
  • no-enviction(驱逐):禁止驱逐数据

注意这里的6中机制,volatile和allkeys规定了是对已设置过期时间的数据集淘汰数据还是从全部数据集淘汰数据,后面的lru、ttle以及random是3中不同的淘汰策略,再加上一个no-enviction永不回收策略
使用策略规则

  • 如果数据呈现幂律分布,也就是一部分数据访问频率高,一部分数据访问频率低,则使用allkeys-lru
  • 如果数据呈现平等分布,也就是所有的数据访问频率都相同,则使用allkeys-random

    为什么redis需要把所有的数据放到内存中

    redis为了达到最快的读写速度将数据都读到内存中,并通过异步的方式将数据写入磁盘。所以redis具有快速和数据持久化的特征。如果不将数据放入内存中,磁盘I/O速度严重影像redis的性能。再内存越来越便宜的今天,redis将会越来越受欢迎。如果设置了最大使用的内存,则数据已有记录数达到内存值后不能继续插入新值。

    redis的同步机制是什么

    redis可以使用主从同步,从从同步。第一次同步时,主节点做一次bgsave,并同时将后续修改操作记录到内存buffer,待完成后将rdb文件全量同步到复制节点,复制节点接收完成后将rdb镜像加载到内存。加载完成后,再通知主节点将期间修改的操作记录同步到复制节点进行重放就完成了同步过程。

    pipeline有什么好处,为什么要用pipeline

    可以将多次IO往返时间缩减为一次,前提时pipeline执行的指令之间没有因果相关性。使用redis-benchmark进行压测的时候可以发现影响redis的QPS峰值的一个重要因素时pipeline批次指令的数目。

    是否使用过redis集群,集群的原理是什么

  • redis sentinal着眼于高可用,再master宕机时会自动将slave提升为master,继续提供服务。

  • redis cluster着眼于拓展性,在单个redis内存不足时,使用cluster进行分片存储

    redis集群方案什么情况下会导致集群不可用*

    由ABC三个节点的集群,在没有复制模型的情况下,如果节点B失败了,那么整个集群就会以为缺少5501-11000这个范围的槽而不可用。

    redis支持的java客户端有哪些?官方推荐用哪个

    redisson、jedis、lettuce等,官方推荐redisson

    jedis与redisson对比有什么优缺点?

    jedis是redis的java实现的客户端,其api提供了比较全面的redis命令支持
    redisson实现了分布式和可拓展的java数据结构,和jedis相比,功能较为简单,不支持字符串操作,不支持排序、事务、管道、分区等redis特性
    redisson的宗旨是促进使用者对redis的关注分离,从而让使用者能够将经理更集中的放在业务逻辑上

    redis如何设置密码以及验证密码

    设置密码:config set requirepass 123456
    授权密码:auth 123456

    说说redis哈希槽的概念

    redis集群没有使用一致性hash,而是引入了哈希槽的概念,redis集群由16384个哈希槽,每个key通过CRC16校验后对16384取模来决定放在哪个槽,集群的每个节点负责一部分hash槽。

    redis集群的主从模型是怎样的

    为了使在部分节点失败或者大部分节点无法通信的情况下集群仍然可用,所以集群使用了主从复制模型,每个节点都会有N-1个复制品。

    redis集群会有写操作丢失吗,为什么

    redis并不能保证数据的强一致性,这意味着在实际中集群在特定的条件下可能丢失写操作

    redis集群之间是如何复制的*(缺少过程)

    异步复制

    redis集群最大节点个数是多少

    16384个。

    redis集群如何选择数据库

    redis集群目前无法做数据库选择,默认在0数据库。

    怎么测试redis的连通性

    使用ping命令

    怎么理解redis的事务

  1. 事务时一个单独的隔离操作:事务中的所有命令都会序列化、按顺序的执行。事务在执行的过程中,不会被其他客户端发来的命令请求所打断。
  2. 事务是一个原子操作,事务中的命令要么全部执行,要么全部不执行

    redis事务相关的命令有哪几个

    MULTI、EXEC、DISCARD、WATCH

    redis key 的过期时间和永久有效分别如何设置

    EXPIRE和PERSIST

    redis如何做内存优化

    尽可能地使用散列表(hashes),散列表(是说散列表里存储的数少)使用的内存非常小,所以你应该尽可能的将你的数据模型抽象到一个散列表里。比如你的web系统中有一个用户对象,不要用这个用户的姓氏、名称、邮箱、密码设置单独的key,而是应该把这个用户的所有信息存储到一张散列表内。

    redis回收进程如何工作*

    一个客户端运行了新的命令,添加了新的数据。redis检查内存使用情况,如果大于maxmemory的限制,则根据设定好的策略进行回收。一个新的命令被执行,等等。所以我们不断地穿越内存限制的边界,通过不断达到边界然后不断地回收回到边界以内。如果一个命令的结果导致大量内存被使用(例如很大的集合的交集保存到一个新的键),不用多久内存限制就会被这个内存使用量超越。

    都有哪些办法可以降低redis的内存使用情况

    如果你使用的是32为的redis实例,可以好好利用hash、list、sorted set、set等集合数据类型,因为通常情况下很多小的key-value可以用更紧凑的方式存到一起

    redis的内存用完了会发生什么

    如果达到设置的上限,redis的写命令会返回错误信息(但是都命令还是可以正常返回)。或者你可以将redis当缓存使用来配置淘汰机制,当redis达到内存上限是会flush掉旧内存。

    一个redis实例最多能存放多少的keys?list、set、sorted set 它们最多都能存放多少元素*

    理论上redis可以处理多大2^32(原来写的232,我猜是2^32?查一下)的keys,并且在实际中进行了测试,每个实例至少存放了两亿五千万的keys。我们正在测试一些较大的值。任何list、set和sorted set都可以存放232(?)个元素。换句话说,redis存储的极限是系统中可用的内存值。

    mysql里有2000w数据,redis中只存20w数据,如何保证redis中的数据都是热点数据?redis内存数据集大小上升到一定大小的时候,就会实行数据淘汰策略**

redis最适合的场景

会话缓存(session cache)
最常用的一种使用redis的情景是会话缓存。用redis缓存的话会比其他存储(如memcached)的优势在于:redis提供持久化。当维护一个不是严格要求一致性的缓存时,可以使用redis。并且随着redis这些年的改进,很容易找到如何恰当的使用redis来缓存会话的文档。
全页缓存(FPC)
除基本的会话token之外,redis还提供很简便的FPC平台。回到一致性的问题,即便重启了redis的实例,因为有磁盘的持久化,用户也不会看到页面加载速度的下降,这是一个极大的改进,类似PHP的本地FPC。
队列(queue)
redis在内存存储引擎领域的一大优点是提供list和set操作,这使得redis能作为一个很好的消息队列平台来使用。redis作为队列使用的操作,就类似于本地程序语言(如python)对list的push/pop操作。如果你快速的在google中搜索redis queues,马上就能找到大量的开源项目,这些项目的目的就是利用redis创建非常好的后端工具,以满足各种队列需求。例如:celery有一个后台就是使用redis作为broker。
排行榜/计数器
redis在内存中对数字进行递增或递减的操作实现的非常好。集合(set)和有序集合(sorted set)也使得我们在执行这些操作的时候变得非常简单,redis只是正好提供了这两种数据结构。
发布/订阅(pub/sub)
最后是redis的发布/订阅功能。发布/订阅的使用场景非常多。可以在社交网络连接中使用,还可以作为基于发布订阅的脚本触发器,甚至用redis的发布/订阅功能来建立聊天系统。

加入redis内有一亿个key,其中有10w个key是以某个固定的已知前缀开头的,如何将它们全部找出来?

使用keys指令可以扫描出指定模式的key列表
对方接着追问:如果这个redis正在给线上业务提供服务,那使用keys会有什么问题:redis是单线程的。keys指令会导致线程阻塞一段时间,线上服务会停顿,直到指令执行完毕,服务才能恢复。这个时候可以使用scan指令,scan指令可以无阻塞的提取出指定模式的keys列表,但是会有一定的重复概率,在客户端做一次去重就可以了,但是整体花费的时间会比keys指令长

如果有大量的key需要设置同一过期时间,一般需要注意什么?

如果大量的key过期时间设置的过于集中,到过期的那个时间点,redis可能会出现卡顿的现象。一般需要在时间上加一个随机值,使得过期的时间分散一些

使用过redis做异步队列吗?你是怎么用的

一般使用list结构作为队列,rpush生产消息,lpop消费消息。当lpop没有消息的时候,要适当sleep一会再去重试
如果对方追问可不可以不用sleep呢
list还有个指令叫blpop,在没有消息的时候,它会阻塞住直到消息到来
如果对方追问能不能生产一次消费多次呢
使用pub/sub主题订阅模式,可以实现1:N的消息队列
如果对方追问pub/sub有什么缺点
在消费者下线的情况下,生产的消息会丢失,得使用专业的消息队列,如rabbitMQ
如果对方追问redis如何实现延时队列
使用sorted set,拿时间戳作为score,消息内容作为key调用zadd来生产消息,消费者用zrangebyscore指令获取N秒之前的数据轮询进行处理

使用过redis分布式锁吗,它是怎么回事

先拿setnx来抢锁,抢到之后,再用expire给锁加一个过期时间防止忘记释放锁。
如果对方追问如果在setnx之后执行expire之前进行意外down掉或要重启维护了,会怎样
set指令可以通过添加参数,同时把setnx和expire合成一条指令来使用