diva-notes
  • README
  • Ads
    • 定价策略
    • 广告层级
    • 归因模型
    • 买量
    • Chat GPT
    • Google
  • AI
    • 参考资料
    • Chat GPT
    • stable-diffusion-webui安装
  • Algorithm
    • 倍增
    • 并查集
    • 参考
    • 环的判断
    • 凸包
    • 蓄水池抽样
    • 最短路径
    • 最小生成树
    • KMP算法
    • Rabin-Karp算法
    • Tarjan桥算法
  • Architecture
    • Serverless
  • Career
  • CICD
    • 代码质量
    • CICD实践
  • Data Structure
    • 布谷鸟过滤器
    • 布隆过滤器
    • 浮点
    • 红黑树
    • 锁
    • LSM树
  • DB
    • My SQL
      • 隔离级别
      • 架构
      • 索引
      • 锁
      • 页结构
      • 主从同步
      • ACID
      • Log
      • MVCC
      • Questions
    • Postgres
      • 持久化
      • 对比MySQL
      • 隔离级别
      • 索引
      • Greenpulm
      • MVCC
    • 倒排索引
    • 列式存储
    • H Base
    • HDFS
    • MPP数据库选型
    • Questions
  • Distributed System
    • 分布式事务
    • 服务网格
    • BASE理论
    • CAP
    • Etcd
    • Raft协议
    • ZAB协议
  • Go
    • 1.语言基础
      • 1.CPU寄存器
      • 2-1.函数调用
      • 2-2.函数调用栈
      • 2.接口
      • 3.汇编
      • 4.调试
    • 2.编译
      • 1.编译
      • 2.词法与语法分析
      • 3.类型检查
      • 4.中间代码生成
      • 5.机器码生成
    • 3.数据结构
      • 1.数组array
      • 2.切片slice
      • 3.哈希表map
      • 4.字符串
    • 4.常用关键字
      • 1.循环
      • 2.defer
      • 3.panic和recover
      • 4.make和new
    • 5.并发编程
      • 1.上下文Context的实现
      • 2-1.runtime.sema信号量
      • 2-2.sync.Mutex的实现
      • 2-3.sync.WaitGroup
      • 2-4.sync.Once的实现
      • 2-5.sync.Map的实现
      • 2-6.sync.Cond
      • 2-7.sync.Pool的实现
      • 2-8.sync.Semaphore的实现
      • 2-9.sync.ErrGroup
      • 3.定时器Timer的实现
      • 4.Channel的实现
      • 5-1.调度-线程
      • 5-2.调度-MPG
      • 5-3.调度-程序及调度启动
      • 5-4.调度-调度策略
      • 5-5.调度-抢占
      • 6.netpoll实现
      • 7.atomic
    • 6.内存管理
      • 1-1.内存分配基础-TCmalloc
      • 1-2.内存分配
      • 2.垃圾回收
      • 3.栈内存管理
    • 参考
    • 各版本特性
    • 坑
    • Go程序性能优化
    • http.Client
    • net.http路由
    • profile采样的实现
    • Questions
    • time的设计
  • Kafka
    • 高可用
    • 架构
    • 消息队列选型
    • ISR
    • Questions
  • Network
    • ARP
    • DNS
    • DPVS
    • GET和POST
    • HTTP 2
    • HTTP 3
    • HTTPS
    • LVS的转发模式
    • NAT
    • Nginx
    • OSI七层模型
    • Protobuf
    • Questions
    • REST Ful
    • RPC
    • socket缓冲区
    • socket详解
    • TCP滑动窗口
    • TCP连接建立源码
    • TCP连接四元组
    • TCP三次握手
    • TCP数据结构
    • TCP四次挥手
    • TCP拥塞控制
    • TCP重传机制
    • UDP
  • OS
    • 磁盘IO
    • 调度
    • 进程VS线程
    • 零拷贝
    • 内存-虚拟内存
    • 内存分配
    • 用户态VS内核态
    • 中断
    • COW写时复制
    • IO多路复用
    • Questions
  • Redis
    • 安装
    • 参考
    • 高可用-持久化
    • 高可用-主从同步
    • 高可用-Cluster
    • 高可用-Sentinel
    • 缓存一致性
    • 事务
    • 数据结构-SDS
    • 数据结构-Skiplist
    • 数据结构-Ziplist
    • 数据结构
    • 数据类型-Hashtable
    • 数据类型-List
    • 数据类型-Set
    • 数据类型-Zset
    • 数据淘汰机制
    • 通信协议-RESP
    • Questions
    • Redis6.0多线程
    • Redis分布式锁
    • Redis分片
  • System Design
    • 本地缓存
    • 错误处理
    • 大文件处理
    • 点赞收藏关注
    • 短链接生成系统
    • 负载均衡
    • 高并发高可用
    • 规则引擎
    • 集卡活动
    • 秒杀系统
    • 评论系统
    • 熔断
    • 限流
    • 延迟队列
    • Docker
    • ES
    • K 8 S
    • Node.js
    • Questions
  • Work
    • Bash
    • Charles
    • Code Review
    • Ffmpeg
    • Git
    • intellij插件
    • I Term 2
    • Mac
    • mysql命令
    • Nginx
    • postgresql命令
    • Protoc
    • Ssh
    • Systemd
    • Tcp相关命令
    • Vim
Powered by GitBook
On this page
  • 高并发
  • 高可用
  1. System Design

高并发高可用

高并发

一般和高性能一起讲

设计层面

  • 网关:负载均衡

  • 服务分布式化、无状态化,支持水平弹性扩容

  • 使用缓存,多级缓存

  • 调用链路热点前置(如CDN

  • 提前容量规划(如使用商品预约功能预估流量

  • 前后端限频、网关限流,阻拦不合理流量,避免不合理流量影响性能

代码层面

  • fail fast 快速失败

  • 可以做并行的地方并行化、异步化,不要用串行逻辑

  • 减小锁粒度;利用分片减小锁范围或无锁化

  • 本地缓存

  • 合并连续请求,一次性批量处理,减小网络传递流量

数据库

  • 根据不同的存储诉求来进行不同的存储选型

  • 设计合理的索引,利用覆盖索引避免回表、排序等

  • 分库分表、读写分离、数据分片

  • 热点数据拆分、隔离、分片

高可用

先明确概念:部分节点挂掉的情况下,仍能提供全部/正常服务

总体思路:1. 预防,2. 容灾(服务&存储、运维)

  • 预防

    • 代码规范

    • 单测:减少 bug,提高健壮性

    • 日志:设计良好的日志能加速发现问题

    • 做好容量规划和评估,对系统要抗住的量级有基本认知,以便设计合理的架构和演进

    • 做好压测

  • 服务与存储

    • 框架有服务治理的功能:

      • 网关:负载均衡、健康检查、故障转移

      • 阻拦不合理流量:鉴权、登录态检查、限流

      • 过载保护:熔断(保护下游)、降级(保证核心功能可用)

    • 异步解耦和削峰设计

      • 异步解耦:如果消费方异常,并不影响生产方,生产方依然可以对外提供服务。消费者恢复后可以继续从消息队列里面消费数据

      • 削峰:不会因为有突发流量而把整个系统打垮

    • 网关、服务、存储都需要多节点冗余,将单点结构转为多点结构,提高可用性

  • 存储层面

    • 集中式存储

      • DB主备、主备切换

      • 业务隔离,分库分表

    • 分布式存储

      • HDFS、HBase、ES 等

    • 缓存

      • Redis 使用哨兵或集群模式

  • 运维层面

    • 自动化CICD:自动化测试、部署;灰度发布(金丝雀发布)、蓝绿发布(新建容器发布后切换)

    • 监控与告警(prometheus + grafana),及时预警和发现故障

    • 容灾

      • 多机房部署

    • 故障演练/接口拨测

      • 接口拨测和巡检类似,每隔一个固定时间调用后端的各种接口,如果接口异常则进行告警

  • 产品层面

    • 兜底策略

      • 比如页面获取不到数据的时候,或者无法访问的时候,要如何友好的告知用户,比如【稍后重试】之类的。

      • 比如页面无法访问的时候,那么需要产品提供一个默认页面,如果后端无法获取真实数据,那么直接渲染默认页面

      • 比如服务器需要停机维护,那么产品层面给一个停机页面,所有用户只会弹出这个停机页面,不会请求后端服务

  • 应急预案

    • 出现问题后怎么快速恢复,不至于让异常事态扩大

    • 依赖的其他服务出现问题的时候,要尽快的进行降级、兜底等各种异常保护措施

参考

Previous负载均衡Next规则引擎

Last updated 2 years ago

AllenWu - 工作十年,谈谈我的高可用架构和系统设计经验