flink-metrics
[参考文献]
Flink Metrics是通过引入com.codahale.metrics包实现的,它将收集的metrics分为四大类:Counter,Gauge,Histogram和Meter下面分别说明:
Counter计数器
用来统计一个metrics的总量。
拿flink中的指标来举例,像Task/Operator中的numRecordsIn(此task或者operator接收到的record总量)和numRecordsOut(此task或者operator发送的record总量)就属于Counter。Gauge指标值
用来记录一个metrics的瞬间值。
拿flink中的指标举例,像JobManager或者TaskManager中的JVM.Heap.Used就属于Gauge,记录某个时刻JobManager或者TaskManager所在机器的JVM堆使用量。Histogram直方图
有的时候我们不满足于只拿到metrics的总量或者瞬时值,当想得到metrics的最大值,最小值,中位数等信息时,我们就能用到Histogram了。
Flink中属于Histogram的指标很少,但是最重要的一个是属于operator的latency。此项指标会记录数据处理的延迟信息,对任务监控起到很重要的作用。Meter平均值
用来记录一个metrics某个时间段内平均值。
flink中类似指标有task/operator中的numRecordsInPerSecond,字面意思就可以理解,指的是此task或者operator每秒接收的记录数。