🛠️ PushNova Ops · Linux 服务器运维监控智能套件
轻量纯 Shell 打造 · 0 额外运行时依赖 · 26 项全景健康指标 · 毫秒级多语言移动端告警推送 · Cron 与 Systemd 双调度引擎
⚡
极致轻量 · 0 外部依赖
全套纯 POSIX Shell + coreutils 编写,无需安装 Python、Node.js 或 Go 等繁重运行时环境,内存开销近乎为 0,任何 Linux 服务器一键即跑。
📊
26 项全谱系健康指标
全方位覆盖系统负载、CPU/内存/磁盘使用率、TCP 连接数、Docker/Podman 容器、TLS 证书有效期、HTTP 状态码探针、Ping 延迟及时钟同步等。
🔕
告警风暴收敛与智能恢复
具备冷却期静默机制与告警指纹去重(Fingerprint)。异常持续时自动折叠计数(xN),故障恢复后即刻下发绿色恢复卡片,拒绝告警轰炸。
📱
双语通知卡片与人机审批
支持全中文与全英文双语卡片自动切换;提供纯文本、Markdown、结构化矩阵表格与趋势折线;支持手机端一键操作按钮与 Webhook 回调。
# 官方 GitHub 源一键安装 / Official GitHub Source
curl -fsSL https://pushnova.stream/ops/dl/install.sh | bash
# 国内加速镜像源安装 (jsDelivr CDN) / Fast Mirror
curl -fsSL https://cdn.jsdelivr.net/gh/netproxy/download@main/ops/install.sh | bash -s -- --mirror
向导配置流程说明:
- 第一步 · 语言选择:支持选择英文(默认)或简体中文。若选择中文,后续交互、命令行提示以及发送到手机的通知均为中文;
- 第二步 · 发信凭据录入:输入本控制台左侧「发信 API Key 与配额」中获取的 API Key;
- 第三步 · 推送目标绑定:选择账号广播、频道主题或设备群组(若安装了 jq 向导将自动列出您当前已配置的频道与群组);
- 第四步 · 监控指标与定时:勾选关心的巡检指标并一键配置 Cron / Systemd 定时任务,即可高枕无忧!
| 命令 | 功能描述 | 常用选项与示例 |
|---|---|---|
pushnova-ops install |
重新唤起交互式安装向导,支持步骤 1 选择中英双语 | -y (非交互静默安装) |
pushnova-ops report |
立即执行全量采集,并向移动设备推送今日巡检日报卡片 | --template rich --dry-run |
pushnova-ops check |
运行健康检查与阈值比对,仅在指标超标且未在静默期时告警 | --force (强制发送) |
pushnova-ops test |
发送一条测试推送通知卡片,验证终端接收与网络链路 | --template test |
pushnova-ops doctor |
全面诊断当前系统的工具链依赖、文件权限、网关连通性与配置 | 无参数直接执行 |
pushnova-ops cron status |
检查受 PushNova Ops 托管的定时巡检与告警调度任务状态 | install | remove |
pushnova-ops config show |
显示当前已生效的全部运维配置、推送目标及各项监控指标阈值 | set KEY VAL |
| 指标分类 | 指标 ID | 指标名称 | 单位 / 类型 | 监控重点说明 |
|---|---|---|---|---|
| 核心资源 | load |
系统负载 · System Load (1m) | - / 数值 | 1/5/15 分钟平均负载,告警阈值自动关联 CPU 核数 |
cpu |
CPU 使用率 · CPU Utilization | % / 数值 | 采样 1 秒窗口的非空闲占比(默认告警阈值 80%/95%) | |
mem |
内存使用率 · Memory Usage | % / 数值 | 基于 Linux 内核 MemAvailable 计算真实内存紧张度 | |
disk |
磁盘使用率 · Disk Usage | % / 数值 | 探测所有真实挂载点中的最高使用率,防爆盘 | |
inode |
inode 使用率 · Inode Usage | % / 数值 | 防止小文件堆积导致 inode 耗尽引发写盘失败 | |
conn |
TCP 连接数 · TCP Connections | - / 数值 | ESTABLISHED + TIME_WAIT 连接总和,防连接池泄漏 | |
| 可用性与网络 | http |
HTTP 可用性 · HTTP Availability | - / 状态 | 探测关键 API 探针,5xx 或超时断开时即刻告警 |
http_latency |
HTTP 响应耗时 · HTTP Latency | ms / 数值 | 所有探测 URL 中的最大响应耗时,防慢请求积压 | |
port |
端口连通性 · Port Connectivity | - / 状态 | MySQL、Redis、Nginx 等关键服务端口连通探测 | |
ping |
主机连通性 · Host Reachability | - / 状态 | 网关或关键外部主机的 ICMP 丢包与连通探测 | |
| 安全与运维 | cert |
TLS 证书有效期 · TLS Cert Days | 天 / 数值 | HTTPS 证书距离过期剩余天数,防止证书忘记续期 |
service |
关键服务存活 · Critical Services | - / 状态 | systemctl / openrc 守护服务存活(sshd, nginx 等) | |
container |
容器状态 · Container Status | - / 状态 | Docker / Podman 运行中与异常停止容器统计 | |
reboot |
系统重启事件 · Reboot Event | - / 状态 | 跟踪系统 boot_id,服务器发生意外重启时即刻报备 |