搜索结果: "sre"
共找到 17 个页面
运维/SRE 行话速查指南:懂了这些,排障都能挺直腰板
标题匹配title: "运维/SRE 行话速查指南:懂了这些,排障都能挺直腰板"
sources: [raw/articles/运维-SRE圈的行话指南-懂了这些-排障都能挺直腰板.md]
# 运维/SRE 行话速查指南:懂了这些,排障都能挺直腰板
## SRE 稳定性
服务器突然卡顿运维排查 SOP — 从告警到根因的完整取证指南
grep -E 'MemAvailable|SwapTotal|SwapFree|Dirty|Slab|SReclaimable' /proc/meminfo
| `Slab` | 内核对象缓存 | `SReclaimable` 理论上可回收;`SUnreclaim` 不可直接回收 |
grep -E '^(AnonPages|Mapped|Shmem|Slab|SReclaimable|SUnreclaim|PageTables|Dirty|Writeback):' /proc/meminfo
Kubernetes DNS 故障排查与高可用实战:从超时到熔断的完整 SOP
tags: [kubernetes, dns, troubleshooting, networking, performance, production, methodology, sre]
2. **监控要前置**。DNS 是基础设施的基础设施,它的异常影响是全局性的。给 CoreDNS 配置完善的监控告警,是 SRE 的基本功。
Linux 内存管理深潜 — Buffer/Cache/Page Cache/Slab/回收/OOM 全链路
| **Slab** | 内核对象缓存(dentry、inode、网络缓冲区等) | `SReclaimable` / `SUnreclaimable` | 可回收部分自动释放 |
SReclaimable: 520000 kB # 可回收 Slab(dentry、inode 缓存)
Wiki Log
| 2026-06-04 14:59 | create | ops-sre-jargon-guide | tags: architecture,networking,monitoring,troubleshooting,performance,deployment,devops | source: 运维技术圈 2026-05-21 | P2 auto-publish, 6 cross-refs |
| 2026-07-20 19:30 | ingest | k8s-dns-troubleshooting-sop | tags: kubernetes,dns,troubleshooting,networking,performance,production,methodology,sre | source: huyouba1 2026-06-21 | 新建 K8s DNS 故障排查完整 SOP 概念页(5类异常+定位SOP+CoreDNS优化+监控指标),3 条入链双向打通;SCHEMA.md 新增 sre 标签 |
Wiki Schema
- sre: SRE 站点可靠性工程实践
MySQL 备份方案对比与选型 — 从工具原理到生产落地的工程手册
**预防**:**季度恢复演练**,演练结论写进 Runbook,结果汇报到 SRE 周会。
DevOps 技术面试指南 — 容器/云原生/内核 59 题
| [[ops-sre-jargon-guide]] | 运维/SRE 行话速查指南:南北流量、APM、SLA、熔断降级、灰度发布、Sidecar 等 15+ |
全栈性能排障方法论 — Nginx → 应用 → 数据库 → 服务器
| [[ops-sre-jargon-guide]] | 运维/SRE 行话速查指南:南北流量、APM、SLA、熔断降级、灰度发布、Sidecar 等 15+ |
高并发四大手段:缓存 / 限流 / 削峰 / 幂等 — 各自解决什么问题?
- [[ops-sre-jargon-guide]] — 运维/SRE 行话速查指南:南北流量、APM、SLA、熔断降级、灰度发布、Sidecar 等 15+
故障复盘完全指南 — 从 5-Why 到改进项闭环
- [[ops-sre-jargon-guide]] — SRE 核心术语与运维规范,涵盖 SLA/MTTR 等复盘关键指标
容器网络排障 6 层模型 — K8s/Docker/containerd 统一排查体系
| [[ops-sre-jargon-guide]] | 运维/SRE 行话速查指南:南北流量、APM、SLA、熔断降级、灰度发布、Sidecar 等 15+ |
JVM 容器 OOM 排障指南 — 堆外内存视角
- [[ops-sre-jargon-guide]] — 运维/SRE 行话速查指南:南北流量、APM、SLA、熔断降级、灰度发布、Sidecar 等 15+
K8s 架构与核心概念深度解析 — 面试通关秘籍(一)
| [[ops-sre-jargon-guide]] | 运维/SRE 行话速查指南:南北流量、APM、SLA、熔断降级、灰度发布、Sidecar 等 15+ |
Node 排障 — NotReady 九步排查 / Kubelet / 容器运行时 / 资源压力 / 证书 / 预防
kubelet 在每个 `nodeStatusReportFrequency` 周期(默认 10 秒)内向 API Server 更新节点状态。判断逻辑在 kube-controller-manager 的 nodecontroller 中:
服务器性能五维排查 — CPU/内存/磁盘/网络/文件系统深度解析
cat /proc/meminfo # MemAvailable, SReclaimable, Swap*
Wiki Index
- [[ops-sre-jargon-guide]] — 运维/SRE 行话速查指南:南北流量、APM、SLA、熔断降级、灰度发布、Sidecar 等 15+ 高频术语白话解释