搜索结果: "disk"

共找到 59 个页面

线上故障排查清单 — CPU/磁盘/内存/GC/网络 四维速查

tags: [troubleshooting, performance, linux, debugging, production, monitoring, disk]

- raw/articles/2026-09-02-deleted-open-file-ghost-disk-space.md

完整证据链(df/du 差值脚本、`/proc` 巡检、mmap 与继承 FD 漏网点、截断前取证、自动巡检脚本)见 [[linux-deleted-file-disk-space-reclaim]]。

详细调优参见 [[linux-disk-io-tuning]](IO 深度优化)和 [[linux-disk-space-troubleshooting]](空间排查流程)。

| [[linux-disk-io-tuning]] | 磁盘 IO 深度调优 |

运维工程师面试 50 题 — 经典 Linux/网络/数据库基础全覆盖

tags: [linux, networking, database, troubleshooting, production, security, monitoring, docker, disk]

- raw/articles/2026-09-02-deleted-open-file-ghost-disk-space.md

fdisk /dev/sda → n → p → w

参见 [[linux-disk-space-troubleshooting]](磁盘空间排查完整流程)。

**面试加分点(2026-09-02 补):** `df` 满而 `du` 小,除了 deleted FD 还有四类成因——挂载点覆盖下层目录、ext4 保留块、快照/配额、稀疏文件与硬链接。且释放顺序有讲究:优先让应用 reopen(`nginx -s reopen` / `kill -USR1`)或优雅重启,应急才 `truncate -s 0 /proc/PID/fd/N`(不可回滚、会丢日志)。见 [[linux-deleted-file-disk-space-reclaim]]。

K8s Pod Evicted 驱逐 — 根因排查与运维应对三板斧

tags: [kubernetes, troubleshooting, pod, deployment, production, monitoring, container, disk, storage]

- raw/articles/2026-09-02-deleted-open-file-ghost-disk-space.md

重点看 `Conditions` 部分是否挂上 `MemoryPressure` 或 `DiskPressure` 标签。

- `The node had condition: DiskPressure` → 磁盘整体压力大

宿主机视角的 deleted FD 证据链见 [[linux-deleted-file-disk-space-reclaim]]。

Node 排障 — NotReady 九步排查 / Kubelet / 容器运行时 / 资源压力 / 证书 / 预防

DiskPressure True KubeletHasDiskPressure ← 磁盘压力

| DiskPressure | 磁盘不足 | 日志/镜像占满磁盘,最常⻅ |

kubelet 的 DiskPressure 检测默认阈值:磁盘空间低于 10% 触发。

**诊断:** `df -h` 磁盘使用率 > 90%,`kubectl describe node` 显示 `DiskPressure=True`

DISK=$(ssh $NODE "df -h / | tail -1 | awk '{print \$5}' | sed 's/%//'")

systemd 日志管理与实时监控:journalctl 命令完全指南

tags: [linux, command, monitoring, debugging, disk]

- raw/articles/2026-09-02-deleted-open-file-ghost-disk-space.md

journalctl --disk-usage # 查看日志占用

journalctl --disk-usage

journalctl --disk-usage

幽灵文件排查 — 删了 200GB 日志磁盘却不释放

tags: [linux, troubleshooting, disk, filesystem, storage, command, monitoring, case-study, production, container, debugging, logrotate]

sources: [raw/articles/2026-09-02-deleted-open-file-ghost-disk-space.md]

contradictions: [linux-disk-space-troubleshooting, linux-server-load-case-study]

journalctl --disk-usage

journalctl --disk-usage

Linux 磁盘故障场景化排查与修复 — 8 大故障场景完整解决方案

tags: [linux, disk, storage, troubleshooting, filesystem, methodology, production, monitoring]

sources: [raw/articles/2026-09-07-linux-disk-fault-scenario-runbook.md]

> 定位:**按故障现象直接对号入座的修复手册**——只读文件系统、超级块损坏、Inode 耗尽、坏道、盘符漂移、挂载夯住、LVM 故障、救援模式 8 大场景,每个场景给「现象 → 成因 → 命令级解决方案」。分区/挂载/LVM 的日常操作手册见 [[linux-disk-partition-mount-guide]],空间排查见 [[linux-disk-space-troubleshooting]],SMART 健康预测见 [[linux-smart-disk-failure-prediction]]。

> 关联深挖:df 有余量但删文件不释放的「幽灵文件」场景是另一类问题,见 [[linux-deleted-file-disk-space-reclaim]];批量小文件删除技巧见 [[linux-mass-file-deletion-guide]]。

> SMART 六大高危指标判读与故障预测模型见 [[linux-smart-disk-failure-prediction]]。

磁盘排查工具实战指南 — iostat/smartctl/lsscsi 详解

tags: [linux, disk, storage, command, monitoring, troubleshooting]

# [0:0:0:0] disk VMware Virtual disk 2.0 /dev/sda

# [0:0:1:0] disk VMware Virtual disk 2.0 /dev/sdb

# sda 8:0 0 100G 0 disk

# sdb 8:16 0 500G 0 disk

磁盘 IO 监控参考 — iostat/vmstat 字段详解与五指标框架

tags: [linux, performance, disk, storage, monitoring, command]

sources: [raw/articles/linux-disk-io-monitoring-guide.md]

- [[linux-disk-io-troubleshoot]] — 磁盘 IO 排查实战(%util 陷阱 + await 真相 + 完整排查决策树)

- [[linux-disk-inspection-tools-guide]] — 磁盘排查工具实战指南(iostat/smartctl/lsscsi 详解)

- [[linux-disk-io-tuning]] — 生产级 Linux 磁盘 IO 调优(调度器/内核参数/fio 基准测试)

磁盘 IO 排查实战 — %util 陷阱与 await 真相

tags: [linux, performance, disk, storage, troubleshooting, monitoring, debugging, command]

sources: [raw/articles/server-slow-disk-io-iostat-iotop-guide.md]

Total DISK READ: 0.00 B/s | Total DISK WRITE: 2.81 M/s

PID PRIO USER DISK READ DISK WRITE COMMAND

完整八场景处置见 [[linux-disk-fault-scenario-runbook]] 场景 6。

生产级 Linux 磁盘 IO 调优 — 从核心概念到实战落地

sources: [raw/articles/linux-disk-io-tuning-guide.md]

| **iotop -b -o** | 按进程查看 IO | `DISK READ/WRITE` / `IO%` |

rate(node_disk_io_time_seconds_total[5m]) * 100

rate(node_disk_read_time_seconds_total[5m]) / rate(node_disk_reads_completed_total[5m]) * 1000

rate(node_disk_read_bytes_total[5m]) / 1024 / 1024

Linux 磁盘分区与挂载完整实操指南 — 从分区到 LVM 生产实战

tags: [linux, disk, storage, command]

> **核心流程:** 查看磁盘 → 选择分区表(MBR/GPT)→ 分区(fdisk/parted/gdisk)→ 格式化(mkfs)→ 挂载 → 配置 fstab 自动挂载。生产推荐 LVM。

fdisk -l /dev/sda # 查看分区表详情

| MBR 分区(<2TB) | `fdisk` | 传统工具,交互友好 |

| GPT 分区(>2TB) | `parted` 或 `gdisk` | parted 支持非交互,gdisk 界面类似 fdisk |

Linux 磁盘空间排查 — 8 个命令 / 四种场景 / 生产清理流程

tags: [linux, troubleshooting, disk, storage, filesystem, monitoring, production, debugging, command]

sources: [raw/articles/linux-disk-space-troubleshooting.md, raw/articles/2026-09-02-deleted-open-file-ghost-disk-space.md]

contradictions: [linux-deleted-file-disk-space-reclaim]

场景化修复手册见 [[linux-disk-fault-scenario-runbook]](Inode 耗尽为其中场景 3)。

> 本场景的完整证据链(df/du 差值脚本、无 lsof 时的 `/proc` 巡检、mmap 与继承 FD 漏网点、截断取证、自动巡检脚本)见 [[linux-deleted-file-disk-space-reclaim]]。

Linux 运维工程师 30 个高频命令速查手册

> 关联排查:[[linux-disk-space-troubleshooting]] — `ls -lhS` 快速定位大文件

> 关联排查:[[linux-disk-space-troubleshooting]] — `find -size` 定位磁盘占用

> 关联排查:[[linux-disk-space-troubleshooting]] — df/du 差异 >5% 的排查方法

> 关联排查:[[linux-disk-io-tuning]] — iostat 深度解读与生产调优

- [[linux-disk-inspection-tools-guide]] — 磁盘排查工具实战指南 — iostat 阈值解读/smartctl 健康诊断/lsscsi 设备列表

Linux 硬件信息查询与软件管理命令速查 — CPU/内存/磁盘/网络/主板全覆盖

tags: [linux, command, performance, monitoring, disk, networking, troubleshooting, architecture]

| `sudo fdisk -l` | 查看所有磁盘分区 |

| `sudo lshw -C disk` | 磁盘详细信息(厂商、容量) |

| [[linux-disk-space-troubleshooting]] | 磁盘空间排查 |

| [[linux-disk-inspection-tools-guide]] | 磁盘排查工具实战指南 — iostat 阈值解读/smartctl 健康诊断/lsscsi 设备列表 |

Linux 系统负载过高排查思路与实战 — 11 步标准流程与 6 场景修复手册

# Total DISK READ: 50.2 M/s | Total DISK WRITE: 80.5 M/s

# TID PRIO USER DISK READ DISK WRITE SWAPIN IO> COMMAND

> IO 排查深挖见 [[linux-disk-io-troubleshoot]](%util 陷阱与 await 真相)与 [[linux-disk-io-monitoring-reference]]。

根本措施:优化应用 IO 模式减少随机读写、使用 SSD 代替机械硬盘、增加磁盘缓存、检查文件系统碎片、检查慢查询导致数据库 IO 过高、检查日志轮转配置避免单个日志文件过大。深挖见 [[linux-disk-io-tuning]]。

**Prometheus + Grafana 重点指标:** node_load1/node_load5/node_load15(Load Average)、node_cpu_seconds_total(CPU 使用时间)、node_memory_MemAvailable_bytes(可用内存)、node_memory_SwapCached_bytes(Swap 使用量)、node_disk_io_time_seconds_total(磁盘 IO 时间)、node_disk_read_bytes_total(磁盘读字节数)、node_disk_written_bytes_total(磁盘写字节数)、node_network_receive_bytes_total(网络接收字节数)、node_network_transmit_bytes_total(网络发送字节数)。以上指标名称仅供参考,实际指标名称取决于使用的 exporter 版本。

Linux 高频运维命令全梳理 — 生产级命令参考手册

tags: [linux, command, troubleshooting, performance, networking, disk]

| 磁盘 | `df`, `du`, `lsblk`, `blkid`, `mount`, `fdisk`, `parted`, `iostat`, `iotop`, `fuser`, `lsof` |

> 磁盘空间排查详见:[[linux-disk-space-troubleshooting]]

### mkfs / fdisk 写错

# sfdisk -d /dev/sda > /tmp/sda-part.bak

Linux RAID 与 LVM 基础指南 — 磁盘组合与空间管理

tags: [linux, storage, disk, architecture, command]

完整八场景故障手册见 [[linux-disk-fault-scenario-runbook]]。

# sda 8:0 100G disk

# sdb 8:16 1T disk

- [[linux-disk-fault-scenario-runbook]] — 磁盘故障场景化修复手册(8 大场景对号入座:只读/超级块/Inode/坏道/盘符漂移/挂载夯住/LVM 故障/救援模式)

Linux rm -rf 误删文件恢复实战指南 — 从事故复盘到数据恢复的完整手册

tags: [linux, troubleshooting, backup, security, disk, filesystem, command, case-study, data-loss]

- raw/articles/2026-09-02-deleted-open-file-ghost-disk-space.md

业界流传的说法是"xfs 删了就没了,ext4 还能救"——不严谨,但方向对:xfs 的恢复工具少、效果差;ext4 的恢复工具链成熟(extundelete、debugfs、testdisk)。

> 这类「已删除但仍打开」的文件也是磁盘空间不释放的元凶(幽灵文件)。**如果目的是回收空间而不是救数据**,处理优先级与完整证据链(df/du 差值、lsof +L1、mmap 与继承 FD、`truncate` 应急)见 [[linux-deleted-file-disk-space-reclaim]]。

### 方案 D:testdisk + photorec(无差别按块扫)

服务器负载过高排查 — 案例实战 / Netflix 60 秒法 / 常见根因

tags: [linux, troubleshooting, performance, production, debugging, case-study, disk]

sources: [raw/articles/linux-server-load-case-study.md, raw/articles/2026-09-02-deleted-open-file-ghost-disk-space.md]

contradictions: [linux-deleted-file-disk-space-reclaim]

iostat -xzm 1 3 # disk IOPS & latency

> ⚠️ **观点分歧(2026-09-02 标注):** 本页早期结论(2026-05-11)把「logrotate `copytruncate`」直接列为长期方案。2026-08-11 的来源指出 `copytruncate` 先复制再截断,对大日志意味着一次全量复制、I/O 翻倍,不适合高写入速率场景。完整证据链见 [[linux-deleted-file-disk-space-reclaim]]。

SMART 磁盘故障预测实战 — 采集管道 + smartd 告警 + XGBoost 模型 + Prometheus 可视化

tags: [linux, disk, monitoring, storage, case-study, automation]

sources: [raw/articles/2026-09-07-smart-disk-failure-prediction-guide.md]

**指标亮红后的坏道处置三步**(2026-09-07 磁盘故障 runbook 补充,坏道修复细节见 [[linux-disk-fault-scenario-runbook]] 场景 4):

for disk in $(lsblk -d -n -o NAME | grep -E '^sd|^nvme'); do

DEV="/dev/${disk}"

服务器性能五维排查 — CPU/内存/磁盘/网络/文件系统深度解析

- raw/articles/2026-09-02-deleted-open-file-ghost-disk-space.md

> **`tune2fs -m` 补充边界(2026-09-02 补):** 这是文件系统级变更,仅适用于 ext4 块设备(先 `findmnt -n -o SOURCE /var` 确认),**不要对 XFS 执行**;根分区的保留块是管理员登录和关键服务写入的保障,不要盲目调低;回滚时若新增空间已被业务写满,恢复更高保留比例会让普通用户可用空间进一步下降。查保留量:`tune2fs -l "$device" | grep -E 'Reserved block count|Reserved block percentage'`。详见 [[linux-deleted-file-disk-space-reclaim]]。

**df 与 du 差异是独立信号(2026-09-02 补):** 同一挂载点上 `df` 明显大于 `du`,说明部分已用块无法经目录树遍历——可能是幽灵文件(已删未释放),也可能是挂载点覆盖下层目录、快照/配额、稀疏文件与硬链接。`df` 含元数据与保留空间、`du` 对硬链接/稀疏文件/权限失败表现不同,**差值不是严格等式**,只有差值达数十 GB 且存在对应 deleted FD,证据链才完整。完整排查见 [[linux-deleted-file-disk-space-reclaim]]。

| [[linux-disk-space-troubleshooting]] | Linux 磁盘空间排查 8 命令(df/du/lsof/journalctl) |

| [[linux-deleted-file-disk-space-reclaim]] | 幽灵文件深度排查 — df/du 差值证据链、ext4 保留块边界、四类差异成因 |

Wiki Index

- [[linux-disk-fault-scenario-runbook]] — Linux 磁盘故障场景化排查与修复 — 8 大故障场景对号入座:只读文件系统/超级块备份恢复/Inode 耗尽/坏道 badblocks+ddrescue/盘符漂移 UUID 治理/挂载夯住 D 状态/LVM 元数据恢复 vgcfgrestore/救援模式 + 巡检清单与数据库盘先导出原则

- [[linux-disk-inspection-tools-guide]] — 磁盘排查工具实战指南 — iostat 阈值解读/smartctl 健康诊断/lsscsi 设备列表/磁盘健康属性详解

- [[linux-disk-io-monitoring-reference]] — 磁盘 IO 监控参考 — iostat/vmstat 字段详解与五指标框架。磁盘使用率/饱和度/IOPS/吞吐量/响应时间五指标框架。iostat 逐字段解读(avg-cpu 段:user/nice/system/iowait/steal/idle;Device 段:rrqm/s/wrqm/s/r/s/w/s/rMB/s/wMB/s/avgrq-sz/avgqu-sz/await/svctm/%util)。vmstat 逐字段解读(procs r/b;memory swpd/free/buff/cache;swap si/so;io bi/bo;system in/cs;cpu us/sy/id/wa/st)。await vs svctm 核心判断。综合决策表(7 种场景)。

- [[linux-disk-io-troubleshoot]] — 磁盘 IO 排查实战 — %util 陷阱与 await 真相。服务器变慢时 CPU/内存正常但磁盘 IO 是凶手。详解 iostat 六大指标(%util/await/r_await/w_await/r/s/w/s)、%util 不等于磁盘损坏的陷阱、IOPS vs 带宽两个维度区别、iotop 找磁盘杀手进程、完整排查决策树(top→iostat→iotop→进程深查)、wa 字段(iowait)含义、df/du 空间排查前置步骤。

- [[linux-disk-io-tuning]] — 生产级 Linux 磁盘 IO 调优:从原理到实战(存储介质/调度算法/文件系统/脏页/工具链/监控告警/案例复盘)

Wiki Log

- Created raw: raw/articles/linux-disk-space-troubleshooting.md

- Created concepts: linux-disk-space-troubleshooting

- Created raw: raw/articles/linux-disk-io-tuning-guide.md

- Created concepts: linux-disk-io-tuning(9 章节覆盖 IO 三要素/存储介质调度/文件系统/工具链/瓶颈识别/内核脏页/应用层优化/监控告警/案例复盘/检查清单)

- Cross-ref inbound links added to: server-performance-four-dimensions, cpu-spike-troubleshooting-guide, linux-memory-management-deep-dive, network-troubleshooting-order, linux-disk-io-tuning

rm -rf 误删文件恢复操作手册 — 从应急响应到工程化预防的完整实践

tags: [linux, command, backup, security, disk, filesystem, container, kubernetes, data-loss]

- ❌ 不要在受影响文件系统上安装 `testdisk`、`extundelete` 等工具

- [[linux-deleted-file-disk-space-reclaim]] — 幽灵文件深度排查 — 已删未释放空间的完整证据链(df/du 差值 / lsof +L1 / mmap 与继承 FD / truncate 应急),与本页共用 /proc/PID/fd 抢救手法

- [[linux-disk-inspection-tools-guide]] — Linux 磁盘检查工具总览

系统负载高排查实战 — rsyslogd + audit 日志刷屏案例

journalctl --disk-usage

journalctl --disk-usage | awk '{print $NF}'

ssh $host "journalctl --disk-usage | tail -1; echo '---TOP3---'; journalctl --since '1 hour ago' | awk '{print \$5}' | sort | uniq -c | sort -rn | head -3; ps aux | grep [r]syslogd | awk '{print \$1, \$3}'"

journalctl --disk-usage

MySQL / Redis 常见故障排查速查清单

SHOW STATUS LIKE 'Created_tmp_disk_tables';

**修复**:在从库关闭 AOF/RDB(仅在从库做持久化由主库负责);调大 `repl-backlog-size`;使用 `repl-diskless-sync`(无盘复制)。

- [[mysql-disk-space-cleanup-guide]] — MySQL 磁盘空间不足时的安全清理指南,哪些文件能用 SQL 清理,哪些绝不能动

K8s 故障排查实战 — 20 个生存法则

| `kubectl get nodes` | 看节点状态:NotReady、DiskPressure、MemoryPressure |

真正要看的是:NodeDiskPressure/NodeMemoryPressure、kubelet 与 API Server 通信失败、证书过期、容器运行时无响应、节点级 OOM 杀掉 kubelet。

**Pod 起不来:** 是 Pending、ContainerCreating、CrashLoopBackOff 还是 OOMKilled?Events 里是调度失败、挂载失败、探针失败还是镜像拉取失败?节点是否存在 DiskPressure/MemoryPressure?request/limit 是否与真实负载严重偏离?

RAID 5 大容量时代重建风险指南 — 写惩罚机制 + URE 二次雪崩 + RAID 6/10 选型

tags: [linux, storage, disk, architecture, case-study]

- [[linux-smart-disk-failure-prediction]] — SMART 磁盘健康监测实战:坏盘前 1-3 周预警、主动换盘,避免"重建还没跑完第二块又掉了"的雪崩场景

- [[linux-disk-io-tuning]] — 磁盘 IO 性能调优(存储介质/调度器/文件系统视角)

Wiki Schema

2026-09-07 拓宽:linux 63页(新增磁盘故障场景化修复 runbook 专页:8 大场景对号入座+巡检清单+数据库盘先导出原则;partition-mount/space-troubleshooting/smart-prediction/raid-lvm/disk-io-troubleshoot 五页增量合并)

- disk: 磁盘管理工具

MySQL 备份方案对比与选型 — 从工具原理到生产落地的工程手册

aliyun ecs CreateSnapshot --DiskId xxx

- [[mysql-disk-space-cleanup-guide]] — MySQL 磁盘空间不足时的安全清理指南,哪些文件能用 SQL 清理,哪些绝不能动

Docker 生产环境踩坑指南 — 10 + 5 个常见问题

| ① | 存储空间耗尽(Disk Full) | 高(服务中断) | 极高 |

### 坑一:Docker 存储空间耗尽(Disk Full)

Linux 目录结构完全指南 — FHS 标准与运维实战

tags: [linux, command, storage, disk, architecture, troubleshooting]

`fdisk`, `mkfs`, `mount`, `sysctl`, `iptables`, `reboot`, `shutdown`, `modprobe`

Linux Load Average 详解:概念、解读与实战判据

- [[linux-disk-io-troubleshoot]] — 磁盘 IO 排查实战 — %util 陷阱与 await 真相。服务器变慢时 CPU/内存正常但磁盘

- [[linux-disk-io-monitoring-reference]] — 磁盘 IO 监控参考 — iostat/vmstat 字段详解与五指标框架。磁盘使用率/饱和度/IO

Linux 内存管理深潜 — Buffer/Cache/Page Cache/Slab/回收/OOM 全链路

- [[linux-disk-io-tuning]] — 磁盘 IO 调优(脏页回写与 Page Cache 关系)

- [[linux-disk-partition-mount-guide]] — Linux 磁盘分区与挂载完整实操:MBR/GPT 选区、fdisk/parted/gdisk 分区

NFS 挂载参数全解析 — 测试与调优指南

> 底层存储:[[linux-disk-io-tuning]](IO 调度与 NFS 性能)

- [[linux-disk-io-tuning]] — 磁盘 IO 调优(NFS IO 路径的底层原理)

Linux 服务器性能排查实战手册 — 三板斧/案例/阈值/参数速查

| [[linux-disk-io-troubleshoot]] |

| [[linux-disk-io-monitoring-reference]] |

服务器突然卡顿运维排查 SOP — 从告警到根因的完整取证指南

tags: [linux, troubleshooting, performance, monitoring, disk, networking, container]

- [[linux-disk-io-troubleshoot]] — 磁盘 IO 排查实战 — %util 陷阱与 await 真相。服务器变慢时 CPU/内存正常但磁盘

Nginx 访问日志暴涨排查手册 — 14 步定位异常 URI 与爬虫流量

# ❌ 不要 rm:fd 仍被持有,空间不释放且 Nginx 写入失效(幽灵文件,见 [[linux-deleted-file-disk-space-reclaim]])

- [[linux-deleted-file-disk-space-reclaim]] — 幽灵文件与磁盘空间回收(本页步骤 10 紧急清理的机制详解)

MySQL 连接失败排查指南 — 从报错定位到根因修复

- [[mysql-disk-space-cleanup-guide]] — MySQL 磁盘空间不足时的安全清理指南

MySQL 磁盘空间紧急处置指南 — 哪些文件能删,哪些绝不能动

tags: [database, mysql, storage, troubleshooting, disk, command]

MySQL 性能调优 — 慢查询 / 锁分析 / 死锁排查 / 索引失效 / 深度分页 / 缓冲池 / 配置模板

| [[mysql-disk-space-cleanup-guide]] |

MySQL 主从复制指南 — 原理 / 手把手搭建 / GTID / 架构 / 故障排查 / 监控

- [[mysql-disk-space-cleanup-guide]] — MySQL 磁盘空间不足的安全清理指南

Ansible Roles 实战全攻略:从零散 Playbook 到可复用项目

| 磁盘使用率告警 | `disk_check.yml` | df 超 80% 自动告警 |

全栈性能排障方法论 — Nginx → 应用 → 数据库 → 服务器

| [[linux-disk-space-troubleshooting]] | 磁盘空间排查 |

Jenkins 多 Master 架构部署方案 — K8S + Gateway API

| `jenkins_node_disk` | Master 磁盘使用率 | > 85% |

K8s 容量规划、Pod QoS 与成本优化实战指南

1. **历史资源水位** — CPU/Memory/Network/Disk 的 P50/P90/P95/P99

Pod Pending 排障指南 — 7 个角度快速定位调度失败根因

| `node.kubernetes.io/disk-pressure` | 磁盘压力 | 默认 NoSchedule |

K8s Pod 调度策略完全指南 — 六大机制全解析

disktype: ssd

K8s 存储生产配置与排障实战:PV/PVC/StorageClass 避坑指南

path: /mnt/disks/ssd1

K8s 生产排障基本原则与快速定位流程

- `kubectl get nodes` → 节点状态(NotReady、DiskPressure、MemoryPressure)

Pod 排障 — CrashLoopBackOff / Exit Code 排查 / OOM / 探针 / 依赖服务 / ConfigMap

| [[linux-disk-space-troubleshooting]] | Linux 磁盘空间排查 8 命令(df/du/lsof/journalctl 等) |

存储排障 — PVC Pending / 挂载失败

fdisk -l

Linux 服务器 CPU 飙高排查 — 完整方法论 + 应急响应实战

| [[linux-disk-io-tuning]] | 磁盘 IO 调优(%sys 高的 IO 路径排查) |

Linux 系统调优实战 — 接口响应从 500ms 降到 100ms 全复盘

| [[linux-disk-io-tuning]] | 磁盘 IO 调优(调度器/文件系统) |

Linux 压缩解压工具对比与实战指南

| [[linux-disk-space-troubleshooting]] | 磁盘空间排查(日志压缩清理策略) |

Linux 高并发内核优化手册 — 文件句柄/网络/内存/调度/I/O/安全七维调优

- [[linux-disk-io-tuning]] — Linux 磁盘 I/O 调优

Linux Load 高但 CPU 低的排查思路 — 系统化诊断流程

| [[linux-disk-io-monitoring-reference]] |

Linux 海量文件删除指南 — find/perl/rsync/shred 四种方法对比

| [[linux-disk-space-troubleshooting]] | 磁盘空间排查(删除后空间不释放问题) |