现在 AI 写代码很像 “次日抛” 一次性产品:拿来快速做原型、做短期交付、做报表大屏效率高,但面向长期运维、持续迭代运营的正式产品,现阶段短板非常明显。
我们这边单表数量有10亿+,也没有做分表。之前讨论过。研发这边的查询条件不能固定。根据时间或者根据区划区分都不好分区。tiflash做加速。注意下并发
我们是从 7.1.1 直接升级到8.5.3 版本,升级后收益很好
这边验证过,在与大表关联查询反而效率更低。原来都是下推到tikv执行。缓存后再tidbserver上执行。所以要是使用一定是独立来使用效果最好。
我们这边一般是和kv配置一样。 tiflash在并发下cpu比较吃紧。
攒积分备考中,一定要认真备考哦,千万不要使用ai哦,ai考不过的哦
我们提前两周进行方案制定与验证,同时这个8.5.3版本是我们在其他业务上再用的版本排除了升级后有不兼容的异常情况。
TiDB主从数据库集群版本升级方案
一、升级概述
1.1升级基本信息
本次升级针对妇幼保健系统生产TiDB主从集群,集群共计20余台服务器,采用主从分层升级模式,保障业务平稳过渡、数据零风险。具体升级参数如下:
当前集群版本:TiDB v7.1.1(生产在线主从集群)
目标升级版本:TiDB v8.5.3
升级方式:停机整体升级,采用先从集群、后主集群分批升级模式,无组件版本共存,升级稳定性更高
升级范围:生产主从集群全组件(PD、TiDB、TiKV、TiFlash、TiCDC)、配套监控组件(Prometheus、Grafana)
验证资源:已向政务云申请3台临时服务器,用于…
本来也是没有报太大希望从技术侧能做的都做到。结果效果很好。每天业务高峰期的慢语句都不见了,客户端异常断开数量一下子降下来了。
你用你的龙虾做什么事情?表现如何?
用龙虾来自动社区签到以及社区问题的整理发送,尝试过去分析grafana监控发现效果不是很好
未来几个月你打算在哪方面去探索和龙虾的协作?
aiops方面在探索
你觉得你跟龙虾协作的过程中产生了哪些问题/哪些惊喜?
没有太大惊喜。沟通还不是很好不能很好的理解,可能是我提问水平有限。
问题 1:在 TiDB 集群出现故障时,您最希望 TEM 的 AI 智能运维功能能够帮助您解决哪些具体问题?
给出修复建议,以及出现问题的原因分析
问题 2:对于 TiDB 集群中的慢查询问题,您希望 TEM 的 AI 智能运维功能能够提供哪些具体的分析和优化能力?
给出SQL优化建议以及索引优化建议。更够根据相同sql调用次数和数据量给出tikv或者tiflash引擎使用建议
问题 3:在日常运维工作中,您最希望 TEM 的 AI 智能运维功能能够自动化哪些巡检和监控任务?
cpu、内存、存储超过限制阈值进行提醒。慢语句监控,高危操作监控
问题 4:对于 TiDB 各…