Redis 笔记

本贴最后更新于 3049 天前,其中的信息可能已经事过景迁

数据结构

  • SortedSet zunionstore 方法可以对一个或者多个有序集合(sortedset)进行并集计算,如果目标集合是set,而不是sorted set,也可以进行合并
  • SortedSet zunionstore 方法,当目标存储集合已经存在时,会进行值的覆盖
  • Hash
    • 这种结构,其内容实现其实是一个HashMap,即key对应一个字符串,而value是使用HashMap实现的。如图

hashredis

    • 只需要通过key+field既可以获取到value值。redis是单线程模型,如果map中的数据过大,遍历需要很长时间的话,就会阻塞客户端其他对redis的操作,这点需要注意。
    • 另外,当hash成员数量较少时,其内部实现是使用类似一维数组的方式(ziplist)来紧凑存储,以节约内存空间,而当成员数量较大时,才会使用hashmap的方式存储。
  • key
    • 必须是一个字符串类型,不能包含边界字符,比如包括空格和换行\n等是被认为非法的,也不能包括redis协议中认定的特殊字符,如\r\n
    • 推荐key的写法是object-type:id:field,同时key不能太长,明显占内存
  • List 内部实现是使用一个双向链表,方便正向和反向进行查找
  • Set
    • 内部实现也是一个HashMap,只是HashMap的value值永远为null
    • set是不会有重复元素的,就是根据计算value的hash值进行快速排重
    • set是无序的,不过可以通过sort命令进行二次排序,而且可以参照第三方的进行排序
  • SortedSet
    • 内部使用HashMap和SkipList实现,skiplist用来存储value,其特点是查找快,节约存储空间。HashMap中存储的是value和score的映射关系
    • 自动排序,即放入其中后,根据score值自动排序,当你需要一个有序且不重复的集合的时候考虑使用sortedset

性能

  • SortedSet 性能取决于其中存储的元素个数

性能

持久化

  • 定时快照方式(snapshot)
    • 内部使用一个定时器,定期检查数据发生的改变次数和时间是否满足配置的持久化触发条件,如果满足就由操作系统fork一个子进程来执行持久化操作,即子进程就可以遍历整个内存空间进行存储,而此时父进程仍然提供正常的服务
    • 该方案的缺点是,存储的定时快照只是一段时间内的内存映像,重启后,上次快照存储后到重启这段时间内的内存数据会丢失
    • 每次做快照方式存储数据时,都会将整个内存数据重新保存一次,而不是增量存储
  • 基于语句追加文件的方式(aof)
    • 即append of file 方式,将每次使redis数据发生变化的语句都会被追加到一个log文件中,这个log文件即是持久化的数据
    • 缺点是数据量大的时侯,log文件体积过大,从而重启时,加载数据进入内存会非常缓慢,几十G的数据需要几个小时,因为每个命令都要执行一遍,另外,每个命令都要写log,redis读写性能也会下降
  • 虚拟内存(vm) — 放弃
  • disk store  — 实践中
  • 在持久化方案中,磁盘IO带来的问题
    • 当使用的物理内存将要达到上限时,会发生redis崩溃的现象,这种情况原因是在读写持久化文件时会将该文件加载到内存中,从而内存中就会有2份重复的数据,导致操作系统让你的进程进行swap操作,此时开始不稳定甚至崩溃(现在已经有maxmemory-policy选项了)
    • 经验是 redis使用的物理内存达到内存总容量的3/5时就比较危险了

事务

  • 提供事务支持,可以保证一串命令操作的原子性,中间不会被其他命令打断,其实质是开启事务后(multi),所有操作命令会放在一个队列中,然后一起执行,保证执行过程中不会被其他命令打断
  • 当这一串命令中某个命令发生错误时,事务终止,同时已经执行的命令不能进行回滚
  • watch命令可以监视某个key,在调用watch命令后到exec执行,这段时间内如果这个key的值发生了变化,那么整个事务就会失败(乐观锁)
  • 在事务中,2个操作存在依赖关系,就要注意了,不能让一个写操作依赖一个读操作,因为事务中的操作并没有立即执行,在事务将操作命令加入队列过程中,有可能其他的客户端会操作这个key,也就是这个key并没有做任何的同步,所以我们需要使用watch来监视此key
  • 关于事务的应用请参考这篇文章

适用场景

  • 朋友最近活动
  • leader board 排行榜功能,在线游戏时,可以随时获取新的排行数据,通过ZRANG
  • 猜测可能认识的人,结合使用ZRANK和ZRANGE方法,可以查出与指定对象相似的对象出来
  • 关注数与被关注数
  • 计数:最近用户在页面间停顿时间不超过60秒的页面浏览量
  • 作为索引数据存储的结构,score存储为数值,value为对象id,使用ZRANGEBYSCORE检索一个确切的范围

用作缓存

  • 2种方式可以把redis当做缓存来使用
    • 给每个键设置一个固定的过期时间,但是这样内存也需要额外的空间来存储这些过期时间
    • 通过设置内存使用上限和指定内存策略算法
maxmemory 2mb
maxmemory-policy allkeys-lru
  • 相比使用额外内存空间存储多个键的过期时间,使用缓存设置是一种更加有效利用内存的方式。而且相比每个键固定的 过期时间,使用LRU也是一种更加推荐的方式,因为这样能使应用的热数据(更频繁使用的键) 在内存中停留时间更久。
  • 基本上这么配置下的Redis可以当成memcached使用。当我们把Redis当成缓存来使用的时候,如果应用程序同时也需要把Redis当成存储系统来使用,那么强烈建议 使用两个Redis实例。一个是缓存,使用上述方法进行配置,另一个是存储,根据应用的持久化需求进行配置,并且 只存储那些不需要被缓存的数据。 

Master Slave复制

  • 一个master可以有多个slave,而一个slave也可以连接其他的slave,形成图状结构
  • master在与slave进行通信时,是可以继续处理客户端请求的;而slave在与master进行通信时,就会阻塞客户端的请求
  • 主从复制的场景,用于提高系统的伸缩性,即让slave负责读取操作,master负责写操作;或者也可以仅仅让slave作为冗余存储
  • 主从复制主要是分为2个步骤,第一个是同步数据,从master中把snapshot发送给slave,第二个是命令传播,master中的写操作都会传递给slave
  • 没有增量复制功能,只是用snapshot重建slave内存结构,新浪微薄版本的redis已经实现了增量复制功能
  • 每次slave重连master,master都会把shapshot重新发送给slave,重建内存数据结构(使用2.8版本+以上的psync命令,可以实现增量复制)
  • 可以通过主动复制来避免redis自身主从复制的缺点,既从客户端对存储的数据进行双写或者多写,数据的多份复制机制,可以避免单点失效故障
  • 这种主动复制功能的缺陷就是如何保证多个节点数据的一致性?需要引入一致性算法,但是这样也会降低写性能
  • 如果有多个slave发来同步命令,master后台只会启动一个进程来写snapshot,然后发送给所有的slave
  • 关于主从复制实现的详细步骤,可以参考黄健宏的视频ppt
  • master最好不要写snapshot,数据量大时会阻塞主线程运行

可扩展集群

  • 100g的业务数据量,假设服务器内存是50g,那么根据磁盘io问题考虑,需要3-4台服务器存储
  • 当数据量达到这个级别时就需要考虑动态在线扩容的问题了
  • 拆分过程(presharding方案)
    • 在新机器上启动好对应端口的Redis实例
    • 配置新端口为待迁移端口的从库
    • 待复制完成,与主库完成同步后,切换所有客户端配置到新的从库的端口
    • 配置从库为新的主库
    • 移除老的端口实例
    • 重复上述过程迁移好所有的端口到指定服务器上

使用总结

  • 根据业务需要选择合适的数据结构,为不同的使用场景设定不同的紧凑型存储参数
  • 当业务场景不需要进行数据持久化时,关闭所有的持久化参数,以获得最大的性能和内存使用量
  • 需要使用持久化时,根据业务特性,是否容忍数据丢失,从而选择aof或者snapshot方式中的一种,不要使用vm和diskstore
  • 不要使得redis实际内存使用量达到最大物理内存的3/5
  • 基于实际项目的一些建议
  • 持久化方案首选AOF方式

改进思路

  • 可以做到按照AOF文件大小自动分割滚动
  • 实际项目可以采取与Mysql结合的方式,即mysql作为主库,Redis作为高速查询从库的异构读写分离的方案

redismysql

客户端、二次开发相关

  • Redis

    Redis 是一个开源的使用 ANSI C 语言编写、支持网络、可基于内存亦可持久化的日志型、Key-Value 数据库,并提供多种语言的 API。从 2010 年 3 月 15 日起,Redis 的开发工作由 VMware 主持。从 2013 年 5 月开始,Redis 的开发由 Pivotal 赞助。

    286 引用 • 248 回帖 • 44 关注
  • slave
    2 引用 • 2 回帖
  • 持久化
    3 引用 • 8 回帖

相关帖子

2 回帖

欢迎来到这里!

我们正在构建一个小众社区,大家在这里相互信任,以平等 • 自由 • 奔放的价值观进行分享交流。最终,希望大家能够找到与自己志同道合的伙伴,共同成长。

注册 关于
请输入回帖内容 ...
  • relyn

    不错支持

  • 其他回帖
  • someone

    谢谢

推荐标签 标签

  • 外包

    有空闲时间是接外包好呢还是学习好呢?

    26 引用 • 232 回帖
  • danl
    146 关注
  • Telegram

    Telegram 是一个非盈利性、基于云端的即时消息服务。它提供了支持各大操作系统平台的开源的客户端,也提供了很多强大的 APIs 给开发者创建自己的客户端和机器人。

    5 引用 • 35 回帖
  • 安装

    你若安好,便是晴天。

    132 引用 • 1184 回帖 • 1 关注
  • Q&A

    提问之前请先看《提问的智慧》,好的问题比好的答案更有价值。

    8449 引用 • 38490 回帖 • 155 关注
  • flomo

    flomo 是新一代 「卡片笔记」 ,专注在碎片化时代,促进你的记录,帮你积累更多知识资产。

    5 引用 • 107 回帖
  • 学习

    “梦想从学习开始,事业从实践起步” —— 习近平

    171 引用 • 512 回帖
  • Hexo

    Hexo 是一款快速、简洁且高效的博客框架,使用 Node.js 编写。

    21 引用 • 140 回帖 • 2 关注
  • 星云链

    星云链是一个开源公链,业内简单的将其称为区块链上的谷歌。其实它不仅仅是区块链搜索引擎,一个公链的所有功能,它基本都有,比如你可以用它来开发部署你的去中心化的 APP,你可以在上面编写智能合约,发送交易等等。3 分钟快速接入星云链 (NAS) 测试网

    3 引用 • 16 回帖 • 6 关注
  • Solidity

    Solidity 是一种智能合约高级语言,运行在 [以太坊] 虚拟机(EVM)之上。它的语法接近于 JavaScript,是一种面向对象的语言。

    3 引用 • 18 回帖 • 400 关注
  • GitBook

    GitBook 使您的团队可以轻松编写和维护高质量的文档。 分享知识,提高团队的工作效率,让用户满意。

    3 引用 • 8 回帖
  • Notion

    Notion - The all-in-one workspace for your notes, tasks, wikis, and databases.

    7 引用 • 40 回帖
  • GitHub

    GitHub 于 2008 年上线,目前,除了 Git 代码仓库托管及基本的 Web 管理界面以外,还提供了订阅、讨论组、文本渲染、在线文件编辑器、协作图谱(报表)、代码片段分享(Gist)等功能。正因为这些功能所提供的便利,又经过长期的积累,GitHub 的用户活跃度很高,在开源世界里享有深远的声望,并形成了社交化编程文化(Social Coding)。

    210 引用 • 2036 回帖
  • JVM

    JVM(Java Virtual Machine)Java 虚拟机是一个微型操作系统,有自己的硬件构架体系,还有相应的指令系统。能够识别 Java 独特的 .class 文件(字节码),能够将这些文件中的信息读取出来,使得 Java 程序只需要生成 Java 虚拟机上的字节码后就能在不同操作系统平台上进行运行。

    180 引用 • 120 回帖 • 3 关注
  • Swagger

    Swagger 是一款非常流行的 API 开发工具,它遵循 OpenAPI Specification(这是一种通用的、和编程语言无关的 API 描述规范)。Swagger 贯穿整个 API 生命周期,如 API 的设计、编写文档、测试和部署。

    26 引用 • 35 回帖 • 5 关注
  • WiFiDog

    WiFiDog 是一套开源的无线热点认证管理工具,主要功能包括:位置相关的内容递送;用户认证和授权;集中式网络监控。

    1 引用 • 7 回帖 • 592 关注
  • 反馈

    Communication channel for makers and users.

    123 引用 • 913 回帖 • 250 关注
  • SQLServer

    SQL Server 是由 [微软] 开发和推广的关系数据库管理系统(DBMS),它最初是由 微软、Sybase 和 Ashton-Tate 三家公司共同开发的,并于 1988 年推出了第一个 OS/2 版本。

    21 引用 • 31 回帖 • 4 关注
  • 正则表达式

    正则表达式(Regular Expression)使用单个字符串来描述、匹配一系列遵循某个句法规则的字符串。

    31 引用 • 94 回帖 • 2 关注
  • 开源

    Open Source, Open Mind, Open Sight, Open Future!

    407 引用 • 3578 回帖
  • Latke

    Latke 是一款以 JSON 为主的 Java Web 框架。

    71 引用 • 535 回帖 • 789 关注
  • 创造

    你创造的作品可能会帮助到很多人,如果是开源项目的话就更赞了!

    178 引用 • 997 回帖
  • OpenShift

    红帽提供的 PaaS 云,支持多种编程语言,为开发人员提供了更为灵活的框架、存储选择。

    14 引用 • 20 回帖 • 632 关注
  • CSDN

    CSDN (Chinese Software Developer Network) 创立于 1999 年,是中国的 IT 社区和服务平台,为中国的软件开发者和 IT 从业者提供知识传播、职业发展、软件开发等全生命周期服务,满足他们在职业发展中学习及共享知识和信息、建立职业发展社交圈、通过软件开发实现技术商业化等刚性需求。

    14 引用 • 155 回帖
  • MyBatis

    MyBatis 本是 Apache 软件基金会 的一个开源项目 iBatis,2010 年这个项目由 Apache 软件基金会迁移到了 google code,并且改名为 MyBatis ,2013 年 11 月再次迁移到了 GitHub。

    170 引用 • 414 回帖 • 387 关注
  • GAE

    Google App Engine(GAE)是 Google 管理的数据中心中用于 WEB 应用程序的开发和托管的平台。2008 年 4 月 发布第一个测试版本。目前支持 Python、Java 和 Go 开发部署。全球已有数十万的开发者在其上开发了众多的应用。

    14 引用 • 42 回帖 • 779 关注
  • 导航

    各种网址链接、内容导航。

    42 引用 • 175 回帖