原理预计 30 分钟
网络可观测性:指标、流日志与抓包
把"网络好不好"变成可以画在看板上、能告警的具体数字。
学完这节你能做到
- 列出必须采集的网络指标及其告警阈值
- 用流量可见性工具定位一次跨服务调用失败
- 设计一套在故障时真的能用的抓包流程
建议先学跳过这几节会看不懂本节的部分推导
正文待编写以下是本节已定稿的小节大纲
- 1主机侧指标:丢包、重传、队列、PPS
- 2网卡与交换机侧:PFC 计数、ECN 标记、端口错误
- 3RDMA 专属计数器怎么看
- 4流量可见性:Hubble 与 conntrack 视角
- 5抓包工程化:什么时候抓、抓多少、存哪里
- 6看板设计:先看什么后看什么
延伸资料
- ·k8s-in-action
o11y/ - ·k8s-in-action
network/cilium/README.md