Business 和 Enterprise 功能

需要时扩容,不需要时缩容

设置一次 CPU 和内存阈值。sh0 在负载高峰时添加副本,下降时移除,并自动负载均衡流量。无需编排器。无需 YAML。无需凌晨 3 点的告警。

您获得什么

指标驱动的伸缩、副本管理和智能负载均衡 -- 全部内置。

基于 CPU 的伸缩
根据容器间的平均 CPU 使用率扩缩副本
基于内存的伸缩
当内存消耗超过阈值时触发伸缩事件
最小/最大副本限制
设置硬限制,确保永远不会过度伸缩或资源不足
冷却期
可配置冷却期防止伸缩事件之间的抖动
负载均衡
轮询、最少连接或随机分配到各副本
健康感知路由
仅将流量路由到通过健康检查的健康副本

工作原理

01

设置 CPU/内存阈值

定义触发伸缩的百分比 -- 例如 CPU 超过 70% 或内存超过 80% 时扩容。

02

定义最小和最大副本数

设置副本数量的下限和上限。最小值确保可用性;最大值控制资源使用。

03

配置冷却期

设置伸缩事件之间的最短时间(如 60 秒),以防止负载波动时的快速振荡。

04

sh0 根据负载自动伸缩

自动伸缩器持续监控指标并实时调整副本数量。无需手动干预。

伸缩流水线

流量高峰
指标采集器
超过阈值
扩容副本
负载均衡器
分配流量

整个周期在几秒内完成 -- 无编排器开销,无 Pod 调度延迟

一应俱全

CPU 和内存阈值

分别设置 CPU 和内存使用率的阈值。任一指标超过阈值即触发伸缩。

最小/最大副本限制

定义最小副本数确保高可用性,最大副本数控制成本。sh0 在限制范围内运行。

可配置冷却期

通过冷却窗口防止伸缩抖动。伸缩事件后,sh0 等待后再重新评估。

3 种负载均衡策略

选择轮询实现均匀分配、最少连接实现智能路由,或随机实现简单分配。随时切换。

健康检查感知

健康检查失败的副本自动从负载均衡器池中移除。流量只发送到健康实例。

支持缩容到零

将最小副本数设为零,空闲时 sh0 关闭所有实例。适用于暂存、开发和低流量应用。

传统方式

  • x 手动 SSH 并启动容器
  • x 猜测流量模式
  • x 对突发流量没有自动响应
  • x 过度配置以求安全
  • x 为闲置资源付费
  • x 凌晨 3 点被叫醒扩容

sh0 的方式

  • 设置一次阈值
  • 负载时自动扩容
  • 空闲时自动缩容
  • 自动负载均衡
  • 健康检查路由流量
  • 流量高峰时安心入睡

常见问题

什么指标触发伸缩? +
CPU 使用率和内存使用量,以所有运行副本的百分比来衡量。您可以分别设置阈值 -- 例如,CPU 70% 或内存 80% 时扩容,以先触发的为准。
伸缩有多快? +
阈值突破后几秒内启动新副本(受冷却期限制)。由于 sh0 使用预构建的 Docker 镜像,没有构建步骤 -- 容器从现有镜像立即启动。
有哪些负载均衡策略? +
三种策略:轮询(请求按顺序均匀分配)、最少连接(发送到处理最少活跃请求的副本)和随机(随机分配)。您可以随时切换策略,无需停机。
可以缩容到零吗? +
可以。将最小副本数设为 0,指标低于阈值时 sh0 将关闭所有实例。第一个传入请求触发冷启动。适用于暂存环境或低流量服务。
冷却期如何工作? +
伸缩事件(扩容或缩容)后,sh0 在冷却期内不会重新评估指标。这可以防止负载在阈值附近波动时的快速振荡。默认 60 秒,可按应用配置。
适用于数据库吗? +
自动伸缩专为无状态应用容器设计。数据库和其他有状态服务不应自动伸缩 -- sh0 会阻止您在数据库容器上启用此功能以保护数据完整性。

自动处理任何流量

基于 CPU 和内存的自动伸缩,内置负载均衡。无需编排器。