搜索结果: "sre"

共找到 17 个页面

运维/SRE 行话速查指南:懂了这些,排障都能挺直腰板

标题匹配

title: "运维/SRE 行话速查指南:懂了这些,排障都能挺直腰板"

sources: [raw/articles/运维-SRE圈的行话指南-懂了这些-排障都能挺直腰板.md]

# 运维/SRE 行话速查指南:懂了这些,排障都能挺直腰板

## SRE 稳定性

服务器突然卡顿运维排查 SOP — 从告警到根因的完整取证指南

grep -E 'MemAvailable|SwapTotal|SwapFree|Dirty|Slab|SReclaimable' /proc/meminfo

| `Slab` | 内核对象缓存 | `SReclaimable` 理论上可回收;`SUnreclaim` 不可直接回收 |

grep -E '^(AnonPages|Mapped|Shmem|Slab|SReclaimable|SUnreclaim|PageTables|Dirty|Writeback):' /proc/meminfo

Kubernetes DNS 故障排查与高可用实战:从超时到熔断的完整 SOP

tags: [kubernetes, dns, troubleshooting, networking, performance, production, methodology, sre]

2. **监控要前置**。DNS 是基础设施的基础设施,它的异常影响是全局性的。给 CoreDNS 配置完善的监控告警,是 SRE 的基本功。

Linux 内存管理深潜 — Buffer/Cache/Page Cache/Slab/回收/OOM 全链路

| **Slab** | 内核对象缓存(dentry、inode、网络缓冲区等) | `SReclaimable` / `SUnreclaimable` | 可回收部分自动释放 |

SReclaimable: 520000 kB # 可回收 Slab(dentry、inode 缓存)

Wiki Log

| 2026-06-04 14:59 | create | ops-sre-jargon-guide | tags: architecture,networking,monitoring,troubleshooting,performance,deployment,devops | source: 运维技术圈 2026-05-21 | P2 auto-publish, 6 cross-refs |

| 2026-07-20 19:30 | ingest | k8s-dns-troubleshooting-sop | tags: kubernetes,dns,troubleshooting,networking,performance,production,methodology,sre | source: huyouba1 2026-06-21 | 新建 K8s DNS 故障排查完整 SOP 概念页(5类异常+定位SOP+CoreDNS优化+监控指标),3 条入链双向打通;SCHEMA.md 新增 sre 标签 |

Wiki Schema

- sre: SRE 站点可靠性工程实践

MySQL 备份方案对比与选型 — 从工具原理到生产落地的工程手册

**预防**:**季度恢复演练**,演练结论写进 Runbook,结果汇报到 SRE 周会。

DevOps 技术面试指南 — 容器/云原生/内核 59 题

| [[ops-sre-jargon-guide]] | 运维/SRE 行话速查指南:南北流量、APM、SLA、熔断降级、灰度发布、Sidecar 等 15+ |

全栈性能排障方法论 — Nginx → 应用 → 数据库 → 服务器

| [[ops-sre-jargon-guide]] | 运维/SRE 行话速查指南:南北流量、APM、SLA、熔断降级、灰度发布、Sidecar 等 15+ |

高并发四大手段:缓存 / 限流 / 削峰 / 幂等 — 各自解决什么问题?

- [[ops-sre-jargon-guide]] — 运维/SRE 行话速查指南:南北流量、APM、SLA、熔断降级、灰度发布、Sidecar 等 15+

故障复盘完全指南 — 从 5-Why 到改进项闭环

- [[ops-sre-jargon-guide]] — SRE 核心术语与运维规范,涵盖 SLA/MTTR 等复盘关键指标

容器网络排障 6 层模型 — K8s/Docker/containerd 统一排查体系

| [[ops-sre-jargon-guide]] | 运维/SRE 行话速查指南:南北流量、APM、SLA、熔断降级、灰度发布、Sidecar 等 15+ |

JVM 容器 OOM 排障指南 — 堆外内存视角

- [[ops-sre-jargon-guide]] — 运维/SRE 行话速查指南:南北流量、APM、SLA、熔断降级、灰度发布、Sidecar 等 15+

K8s 架构与核心概念深度解析 — 面试通关秘籍(一)

| [[ops-sre-jargon-guide]] | 运维/SRE 行话速查指南:南北流量、APM、SLA、熔断降级、灰度发布、Sidecar 等 15+ |

Node 排障 — NotReady 九步排查 / Kubelet / 容器运行时 / 资源压力 / 证书 / 预防

kubelet 在每个 `nodeStatusReportFrequency` 周期(默认 10 秒)内向 API Server 更新节点状态。判断逻辑在 kube-controller-manager 的 nodecontroller 中:

服务器性能五维排查 — CPU/内存/磁盘/网络/文件系统深度解析

cat /proc/meminfo # MemAvailable, SReclaimable, Swap*

Wiki Index

- [[ops-sre-jargon-guide]] — 运维/SRE 行话速查指南:南北流量、APM、SLA、熔断降级、灰度发布、Sidecar 等 15+ 高频术语白话解释