#eBPF
当 Prometheus 指标写满共享内存:一次 APISIX CPU 100% 问题的复现与分析
前几天在 APISIX 的 issue 列表里看到一个很有意思的故障(apache/apisix#12275):一套由 38 台网关组成的集群里,有 2 台突然 CPU 飙到 100%,彻底不干活了。运维的第一反应是把这两台的流量切走——奇怪的是,没有新的流量了,CPU 却还是死死钉在 100%,像被什么东西困住了一样。
当 Prometheus 指标写满共享内存:一次 APISIX CPU 100% 问题的复现与分析
前几天在 APISIX 的 issue 列表里看到一个很有意思的故障(apache/apisix#12275):一套由 38 台网关组成的集群里,有 2 台突然 CPU 飙到 100%,彻底不干活了。运维的第一反应是把这两台的流量切走——奇怪的是,没有新的流量了,CPU 却还是死死钉在 100%,像被什么东西困住了一样。