性能监控之国产时序库TDengine TDinsight dashboard 指标解析 📅 发布时间:2026/8/18 13:23:48 👁 浏览次数: 文章目录一、前言二、主要逻辑单元说明三、集成监控四、监控数据库五、Dashboard 看板一集群状态Cluster Status1、整体视角2、分项说明二DNodes 概述DNodes Overview三请求Requests1、整体视角2、分项说明四DNode 资源使用情况DNode Usage1、整体视角2、分项说明一、前言TDengine 是一款专为物联网、工业互联网等场景时序数据库目前为国产化信创项目中的主流方案。本文主要总结解析TaosKeeper Prometheus Dashboard for 3.x dashboard让大家对 TDengine 主流监控指标有个整体了解方便平常在性能监控工作查阅。二、主要逻辑单元说明TDengine 分布式架构的逻辑结构图如下一个完整的 TDengine 系统是运行在一到多个物理节点上的逻辑上它包含数据节点dnode、TDengine 应用驱动taosc以及应用app。系统中存在一到多个数据节点这些数据节点组成一个集群cluster。应用通过 taosc 的 API 与 TDengine 集群进行互动。下面对主要逻辑单元进行简要介绍。数据节点dnode dnode 是 TDengine 服务器侧执行代码 taosd 在物理节点上的一个运行实例一个工作的系统必须有至少一个数据节点。dnode 包含零到多个逻辑的虚拟节点vnode零或者至多一个逻辑的管理节点mnode零或者至多一个逻辑的弹性计算节点qnode零或者至多一个逻辑的流计算节点snode。虚拟节点vnode 为更好的支持数据分片、负载均衡防止数据过热或倾斜数据节点被虚拟化成多个虚拟节点vnode图中 V2V3V4 等。每个 vnode 都是一个相对独立的工作单元是时序数据存储的基本单元具有独立的运行线程、内存空间与持久化存储的路径。一个 vnode 包含一定数量的表数据采集点管理节点mnode 一个虚拟的逻辑单元负责所有数据节点运行状态的监控和维护以及节点之间的负载均衡图中 M。同时管理节点也负责元数据包括用户、数据库、超级表等的存储和管理因此也称为 Meta Node。TDengine 集群中可配置多个最多不超过 3 个mnode它们自动构建成为一个虚拟管理节点组图中 M1M2M3。虚拟节点组VGroup 不同数据节点上的 vnode 可以组成一个虚拟节点组vgroup采用 RAFT 一致性协议保证系统的高可用与高可靠。三、集成监控TDengine 通过 taosKeeper 将服务器的 CPU、内存、硬盘空间、带宽、请求数、磁盘读写速度等信息定时写入指定数据库。TDengine 还将重要的系统操作比如登录、创建、删除数据库等日志以及各种错误报警信息进行记录。系统管理员可以从 CLI 直接查看这个数据库也可以在 WEB 通过图形化界面查看这些监测信息。具体可以参考官网的资料我就不再此赘述了。https://docs.taosdata.com/reference/taosKeeper/四、监控数据库TDinsight dashboard 数据来源于 log 库存放监控数据的默认db可以在 taoskeeper 配置文件中修改具体参考 taoskeeper 文档。taoskeeper 启动后会自动创建 log 库并将监控数据写入到该数据库中。相关表说明cluster_info 表记录集群信息。d_info 表记录 dnode 状态信息。m_info 表记录 mnode 角色信息。dnodes_info 记录 dnode 信息。data_dir 表记录 data 目录信息。log_dir 表记录 log 目录信息。temp_dir 表记录 temp 目录信息。vgroups_info 表记录虚拟节点组信息。vnodes_role 表记录虚拟节点角色信息。log_summary 记录日志统计信息。grants_info 记录授权信息。keeper_monitor 记录 taoskeeper 监控数据。taosadapter_restful_http_request_total 记录 taosadapter rest 请求信息该表为 schemaless 方式创建的表时间戳字段名为 _ts。taosadapter_restful_http_request_fail 记录 taosadapter rest 请求失败信息该表为 schemaless 方式创建的表时间戳字段名为 _ts。taosadapter_restful_http_request_in_flight 记录 taosadapter rest 实时请求信息该表为 schemaless 方式创建的表时间戳字段名为 _ts。taosadapter_restful_http_request_summary_milliseconds 记录 taosadapter rest 请求汇总信息该表为 schemaless 方式创建的表时间戳字段名为 _ts。taosadapter_system_mem_percent 表记录 taosadapter 内存使用情况该表为 schemaless 方式创建的表时间戳字段名为 _ts。taosadapter_system_cpu_percent 表记录 taosadapter cpu 使用情况该表为 schemaless 方式创建的表时间戳字段名为 _ts。五、Dashboard 看板taosdata 提供了TaosKeeper Prometheus Dashboard for 3.x dashboarddashboard ID18587。一集群状态Cluster Status1、整体视角这部分包括集群当前信息和状态告警信息也在此处从左到右从上到下。2、分项说明指标说明First EP当前TDengine集群中的firstEp设置。VersionTDengine 服务器版本master mnode。Master Uptime: 当前Master MNode 被选举为 Master 后经过的时间。Expire Time - 企业版过期时间。指标说明Used Measuring Points - 企业版已使用的测点数。Databases - 数据库个数。Tables - 当前表个数。Connections - 当前连接个数。指标说明DNodes/MNodes/VGroups/VNodes每种资源的总数和存活数。指标说明DNodes/MNodes/VGroups/VNodes Alive Percent每种资源的存活数/总数的比例启用告警规则并在资源存活率1分钟内平均健康资源比例不足100%时触发。指标说明Measuring Points Used启用告警规则的测点数用量社区版无数据默认情况下是健康的。Grants Expire Time启用告警规则的企业版过期时间社区版无数据默认情况是健康的指标说明Error Rate启用警报的集群总合错误率每秒平均错误数。二DNodes 概述DNodes Overview指标说明DNodes Statusshow dnodes 的简单表格视图。DNodes Lifetime从创建 dnode 开始经过的时间。DNodes NumberDNodes 数量变化。MNodes NumberMNodes 数量变化。三请求Requests1、整体视角2、分项说明指标说明Requests (Inserts)累计插入次数。指标说明Requests Rate(Inserts per Second)平均每秒插入次数。指标说明Requests (Selects)查询请求数及变化率count of second。四DNode 资源使用情况DNode Usage1、整体视角2、分项说明指标说明Uptime从创建 dnode 开始经过的时间。Has MNodes?当前 dnode 是否为 mnode。CPU CoresCPU 核数。VNodes Number当前dnode的VNodes数量。VNodes Masters处于master角色的vnode数量。指标说明Current CPU Usage of taosdtaosd进程的CPU使用率。Current Memory Usage of taosdtaosd进程的内存使用情况。Disk Usedtaosd数据目录的总磁盘使用百分比。指标说明CPU Usage进程和系统 CPU 使用率。RAM UsageRAM 使用指标时间序列视图。指标说明Disk Used多级存储下每个级别使用的磁盘默认为 level0 级。Disk Increasing Rate per Minute每分钟磁盘用量增加或减少的百分比。指标说明Disk IO磁盘IO速率。Net IO网络IO除本机网络之外的总合网络IO速率。参考资料taosdata官网TDinsight - 基于Grafana的TDengine零依赖监控解决方案