偶尔报错代码8027

【TiDB 使用环境】生产环境
【TiDB 版本】6.1.1
【操作系统】centos7
【部署方式】机器部署(海光+华为、机械硬盘)
【集群数据量】
【集群节点数】
【问题复现路径】用python写入数据偶尔报错pymysql.err.OperationalError: (8027, ‘Information schema is out of date: schema failed to update in 1 lease, please make sure TiDB can connect to TiKV’)
【遇到的问题:问题现象及影响】
【资源配置】进入到 TiDB Dashboard -集群信息 (Cluster Info) -主机(Hosts) 截图此页面




集群总计

版本
v6.1.1

总实例数量
16
实例部署的总机器数量
7
内存总量总和 (按实例部署的机器计算)
2.5 TiB
CPU 物理核心数总和 (按实例部署的机器计算)
272
CPU 逻辑核心数总和 (按实例部署的机器计算)
400

子统计按不同实例类型分别计算。当一个机器上部署了不同类型实例时,以下子统计的机器指标累加起来会超过“集群总计”数量。

PD

总实例数量
4
实例部署的总机器数量
4
内存总量总和 (按实例部署的机器计算)
1.5 TiB
CPU 物理核心数总和 (按实例部署的机器计算)
168
CPU 逻辑核心数总和 (按实例部署的机器计算)
232

TiDB

总实例数量
2
实例部署的总机器数量
2
内存总量总和 (按实例部署的机器计算)
1007.3 GiB
CPU 物理核心数总和 (按实例部署的机器计算)
128
CPU 逻辑核心数总和 (按实例部署的机器计算)
192

TiKV

总实例数量
8
实例部署的总机器数量
4
内存总量总和 (按实例部署的机器计算)
1017.4 GiB
CPU 物理核心数总和 (按实例部署的机器计算)
80
CPU 逻辑核心数总和 (按实例部署的机器计算)
80

TiFlash

总实例数量
2
实例部署的总机器数量
2
内存总量总和 (按实例部署的机器计算)
1019.4 GiB
CPU 物理核心数总和 (按实例部署的机器计算)
128
CPU 逻辑核心数总和 (按实例部署的机器计算)
256

【复制黏贴 ERROR 报错的日志】
【其他附件:截图/日志/监控】
近期偶尔报错,也没有排查出来啥,tikv跟tidb网络也正常

tidb-server和tikv之间的网络检查下吧

偶尔,有可能是网络问题吗? 查看日志定位原因:TiDB 的日志和 TiKV 的日志中会有更详细的错误信息

监控一下网络抖动的情况。

用ntp同步一下各个节点的时钟吧,看看能不能解决

  • 核心优化:延长 TiDB 的 schema lease 周期(建议 5s),调整 TiKV 配置适配机械硬盘(降低 IO 压力)。
  • 长期建议:监控 TiKV 磁盘 IO 延迟和使用率,避免单节点负载过高,机械硬盘环境下尽量采用批量写入减少请求频次。

版本问题吗

大概率还是网络问题

此话题已在最后回复的 7 天后被自动关闭。不再允许新回复。