求助:TiDB 集群看不到等待事件,节点又多,该用什么指标判断性能瓶颈?

  1. 核心指标:盯TiKV的Raft IO、gRPC延迟、Coprocessor耗时,以及TiDB的SQL执行时间、慢查询数、Connection Count。PD的Leader分布、Region健康度(Pending/Incomplete Region)也是关键。单节点CPU/内存只作参考,别当瓶颈判断依据。