SlaunchX DevOps / 运维 OPS / n-00006 档案

← 返回门户

slaunchx-local-product-codex (slaunchx-n-00006)

定位: 本地生产面 (product 环境宿主) — 承载 sales 域两套完整业务栈 lampayelaypay。Debian 12 (kernel 6.1), x86-64, 12 vCPU, 30G 内存。VPN 内网 10.8.0.7。 SSH 登录用户 root (Codex agent 专用密钥), 经大脑机跳板: ssh experiment "ssh slaunchx-local-product-codex ..."

采集实测 2026-08-18。上游镜像来自 docker-registry.slaunchx.cc, tag 一律 :product

存储布局 (三块盘)

容量 用途 挂载 / 卷
nvme0n1 238G 系统盘 (LVM slaunchx-product-vg) root 23G(8%) · var 9.3G(76%) · home 202G(10%,18G 用) · tmp 1.9G · swap 976M
sda1 440G ext4 docker/containerd 数据盘 (data-root=/data) /data (6.4G 用: containerd 6.2G + docker 7.8G)
sdb1 916G ext4 备份预留盘 /backup (空, 仅 lost+found; 尚无本地备份任务写入)
  • Docker data-root 已迁到独立数据盘 /data, 系统盘只留系统。
  • /var 76% 偏高 (9.3G LV), 需关注 (日志/apt 缓存增长)。
  • /backup 916G 目前完全闲置 — 见下"与 n-00007 的差异"。

服务清单 (2026-08-18 实测, 25 运行容器 + 2 init Exited)

两套同构业务栈, 靠端口段区分: lampay = 210xx, elaypay = 220xx (容器内统一 18020 等)。

业务栈 lampay (compose project java-lampay, 网络 java-lampay)

组件 镜像 宿主端口 → 容器
app-prometheus (主应用) slaunchx-app-prometheus:product 21020→18020
service-email slaunchx-service-email:product 21030→18030
service-schedule slaunchx-service-schedule:product 21050→18050
service-dingtalk slaunchx-service-dingtalk:product 21061→18061
service-slash slaunchx-service-slash:product 21080→18080
service-photonpay slaunchx-service-photonpay:product 21100→18100
MySQL mysql:8.4.8 21306→3306
Redis redis:7.2.13 127.0.0.1:21379→6379
MinIO (API/Console) minio:2025-04-22 127.0.0.1:21000/21001
RabbitMQ (amqps/mgmt) rabbitmq:3.13.7-management 127.0.0.1:21572/21672
telegram-alert java-lampay-telegram-alert (本地构建) 无宿主端口

业务栈 elaypay (compose project java-elaypay, 网络 java-elaypay)

组件 宿主端口 → 容器
app-prometheus 22020→18020
service-email / schedule / dingtalk / slash / photonpay 22030 / 22050 / 22061 / 22080 / 22100
MySQL 22306→3306
Redis 127.0.0.1:22379→6379
MinIO (API/Console) 127.0.0.1:22000/22001
RabbitMQ (amqps/mgmt) 10.8.0.7:22572/22672 (绑 VPN IP, 非 127.0.0.1)
telegram-alert 无宿主端口

注意: elaypay 的 RabbitMQ 绑在 VPN 网卡 10.8.0.7 而非 lampay 那样的 127.0.0.1 — 全 VPN 段可达 (非公网), 与 lampay 不对称。app-prometheus 与各微服务均 0.0.0.0 监听, 因此网关 n-00008 的 nginx 可经 10.8.0.7:21020/22020 反代其对外域名。

平台/宿主服务

类别 服务 说明
密钥 openbao (127.0.0.1:8200) + openbao-auto-unseal compose 在 /home/ops/devops/docker/openbao; 容器内 0.0.0.0:8200, 映射宿主 127.0.0.1
日志 remote-promtail-docker 采集容器日志 → 推 n-00007 Loki http://10.8.0.3:23100 (compose logging/remote-docker)
宿主 fleet-agent v0 (/opt/slaunchx-fleet) + v1 (/opt/zmuke-fleet-agent, /etc/zmuke-fleet, 60s) 双栈 上报大脑机 fleet 控制面
VPN openvpn-client (vpncentre 托管) + watchdog + vpncentre-agent + @mgmt + @mgmt-usa 见下网络
防护 fail2ban (active), smartd (active) node_exporter 未运行
  • compose 工作目录: 业务栈 /home/ops/devops/docker/java (共享 config/environment/mysql-init/telegram-alert 子目录), openbao .../openbao, 日志 .../logging/remote-docker
  • docker 网络: java-lampay / java-elaypay / java-product / openbao / remote-docker_default + 默认 bridge/host/none。

网络 (三条 OpenVPN 隧道)

隧道 本机 IP 对端 (server:port) 用途
tun0 10.8.0.7/24 64.186.238.106:15957 slaunchx-vpn 主内网 (网关虚拟 IP 10.8.0.1)
tun1 10.8.20.112/24 191.222.214.72:4443 mgmt (hub-a UVP328)
tun2 10.8.21.112/24 64.186.238.106:4443 mgmt-usa (hub-b DNJ269)

完整拓扑与成员表见 hosts/slaunchx-local-test/ARCHITECTURE.md

已知问题 / 与 n-00007 的差异 (采集发现)

  1. 无本地备份任务: 只有 dpkg-db-backup.timer; 无 slaunchx-backup / 无异地推送。 916G /backup 盘闲置 → product 两套 MySQL/MinIO 数据目前无备份覆盖, 是缺口。
  2. node_exporter 未运行 (inactive) → 不被 Prometheus 抓取, 主机指标有盲区 (n-00007 为 active)。
  3. remote-promtail备份推送地址 grafana-ai.slaunchx.cc 已废弃 (DNS 删除), 故障切换目标是死链, 仅主链 10.8.0.3:23100 有效。
  4. 每套业务栈只有 app-prometheus + 5 微服务 (无 service-webhook-delivery, n-00007 test/alpha 各带一个)。
  5. unbound-resolvconf 开机竞态 (2026-08-17 已用 drop-in After=unbound + Restart=on-failure 根治)。

凭据: 全部经 vault --business slaunchx 或机上 compose env (/home/ops/devops/docker/**/environment, .env); 只给指针, 不入库明文。