如何在Humio查询语言中筛选唯一(distinct)值?
在Humio中获取结果集的唯一值方法
要在Humio里拿到字段的所有唯一值,直接用distinct()函数就行,不用绕弯子。针对你举的例子,正确的写法是:
select(distinct("kubernetes.namespace_name"))
这个查询会直接返回kubernetes.namespace_name字段下所有不重复的值,不会像单纯的select(["kubernetes.namespace_name"])那样返回数千条重复结果。
如果还需要统计每个唯一值的出现次数,就用groupBy配合count():
groupBy("kubernetes.namespace_name", function=count())
这样会输出每个namespace名称,以及它在结果集中出现的总次数。
之前你用count(...)没得到预期结果,是因为单独的count()默认统计的是结果集的总条数,只有和groupBy结合时,才会按指定字段分组统计每个组的数量。
内容的提问来源于stack exchange,提问作者Funcan
相关产品推荐
相关产品推荐

