Business 和 Enterprise 功能
需要时扩容,不需要时缩容
设置一次 CPU 和内存阈值。sh0 在负载高峰时添加副本,下降时移除,并自动负载均衡流量。无需编排器。无需 YAML。无需凌晨 3 点的告警。
您获得什么
指标驱动的伸缩、副本管理和智能负载均衡 -- 全部内置。
基于 CPU 的伸缩
根据容器间的平均 CPU 使用率扩缩副本
基于内存的伸缩
当内存消耗超过阈值时触发伸缩事件
最小/最大副本限制
设置硬限制,确保永远不会过度伸缩或资源不足
冷却期
可配置冷却期防止伸缩事件之间的抖动
负载均衡
轮询、最少连接或随机分配到各副本
健康感知路由
仅将流量路由到通过健康检查的健康副本
工作原理
01
设置 CPU/内存阈值
定义触发伸缩的百分比 -- 例如 CPU 超过 70% 或内存超过 80% 时扩容。
02
定义最小和最大副本数
设置副本数量的下限和上限。最小值确保可用性;最大值控制资源使用。
03
配置冷却期
设置伸缩事件之间的最短时间(如 60 秒),以防止负载波动时的快速振荡。
04
sh0 根据负载自动伸缩
自动伸缩器持续监控指标并实时调整副本数量。无需手动干预。
伸缩流水线
流量高峰
指标采集器
超过阈值
扩容副本
负载均衡器
分配流量
整个周期在几秒内完成 -- 无编排器开销,无 Pod 调度延迟
一应俱全
CPU 和内存阈值
分别设置 CPU 和内存使用率的阈值。任一指标超过阈值即触发伸缩。
最小/最大副本限制
定义最小副本数确保高可用性,最大副本数控制成本。sh0 在限制范围内运行。
可配置冷却期
通过冷却窗口防止伸缩抖动。伸缩事件后,sh0 等待后再重新评估。
3 种负载均衡策略
选择轮询实现均匀分配、最少连接实现智能路由,或随机实现简单分配。随时切换。
健康检查感知
健康检查失败的副本自动从负载均衡器池中移除。流量只发送到健康实例。
支持缩容到零
将最小副本数设为零,空闲时 sh0 关闭所有实例。适用于暂存、开发和低流量应用。
传统方式
- x 手动 SSH 并启动容器
- x 猜测流量模式
- x 对突发流量没有自动响应
- x 过度配置以求安全
- x 为闲置资源付费
- x 凌晨 3 点被叫醒扩容
sh0 的方式
- 设置一次阈值
- 负载时自动扩容
- 空闲时自动缩容
- 自动负载均衡
- 健康检查路由流量
- 流量高峰时安心入睡
常见问题
什么指标触发伸缩? +
CPU 使用率和内存使用量,以所有运行副本的百分比来衡量。您可以分别设置阈值 -- 例如,CPU 70% 或内存 80% 时扩容,以先触发的为准。
伸缩有多快? +
阈值突破后几秒内启动新副本(受冷却期限制)。由于 sh0 使用预构建的 Docker 镜像,没有构建步骤 -- 容器从现有镜像立即启动。
有哪些负载均衡策略? +
三种策略:轮询(请求按顺序均匀分配)、最少连接(发送到处理最少活跃请求的副本)和随机(随机分配)。您可以随时切换策略,无需停机。
可以缩容到零吗? +
可以。将最小副本数设为 0,指标低于阈值时 sh0 将关闭所有实例。第一个传入请求触发冷启动。适用于暂存环境或低流量服务。
冷却期如何工作? +
伸缩事件(扩容或缩容)后,sh0 在冷却期内不会重新评估指标。这可以防止负载在阈值附近波动时的快速振荡。默认 60 秒,可按应用配置。
适用于数据库吗? +
自动伸缩专为无状态应用容器设计。数据库和其他有状态服务不应自动伸缩 -- sh0 会阻止您在数据库容器上启用此功能以保护数据完整性。