NNetpath
原理预计 30 分钟

网络可观测性:指标、流日志与抓包

把"网络好不好"变成可以画在看板上、能告警的具体数字。

学完这节你能做到

  • 列出必须采集的网络指标及其告警阈值
  • 用流量可见性工具定位一次跨服务调用失败
  • 设计一套在故障时真的能用的抓包流程

建议先学跳过这几节会看不懂本节的部分推导

正文待编写以下是本节已定稿的小节大纲
  1. 1主机侧指标:丢包、重传、队列、PPS
  2. 2网卡与交换机侧:PFC 计数、ECN 标记、端口错误
  3. 3RDMA 专属计数器怎么看
  4. 4流量可见性:Hubble 与 conntrack 视角
  5. 5抓包工程化:什么时候抓、抓多少、存哪里
  6. 6看板设计:先看什么后看什么

延伸资料

  • ·k8s-in-actiono11y/
  • ·k8s-in-actionnetwork/cilium/README.md