elasticsearch分组排序取top N

原創

2020-04-22 07:33

背景

比如有一张通话记录表，里面有用户UID，电话号number，用户所属国家country，通话时长talktime几个主要字段。现在的需求是要获取平均通话时长最长的top 20个国家。

实现

先过滤掉一些不需要的数据，然后根据country分桶，在桶内求平均通话时长。最后根据每个桶的平均通话时长取top 20的桶。

GET talk-information-2020.04.21/_search
{
  "query": {
    "bool": {
      "must":[
      {
        "exists":{
              "field": "country" //必须存在国家字段
            }
		}
    ],
	  "filter": {
	    "range": {
		  "talktime": {
		    "gte": 1000  //通话时长大于等于1秒
		  }
	    }
	  }
    }
  }, 
  "size": 0,
  "aggs": {
    "country": {
      "terms": {
        "field": "country.keyword",  //根据国家分桶
        "size": 100000  //分桶数量（根据实际数据确定）
      },
      "aggs": {
        "avg_time": {
          "avg": {
            "field": "talktime"  //桶内求平均通话时长
          }
        },
      "country_bucket_sort": {
          "bucket_sort": {
              "sort": [
                {"avg_time": {"order": "desc"}}  //根据平均通话时长对桶排序
              ],
              "size": 10  //取前10个桶
          }
        }
      }
    }
  }
}

發表評論

所有評論

還沒有人評論，想成為第一個評論的人麼? 請在上方評論欄輸入並且點擊發布.

相關文章

数据驱动制造：EMQX ECP 指标监测功能增强生产透明度

邁向未來的工業生產，需要的不僅是自動化，更是智能化。如果工業企業的管理者能夠實時監測每一生產環節的設備運行狀態，每一數據點位情況，洞察和優化每一步生產流程，他們將能夠做出更精準的決策，提高生產效率和產品質量。通過集成先進的指標監測工具，

2024-06-03 22:11:10

探讨篇（一）：服务粒度的艺术 - 简化架构与避免服务泛滥

一、背景上週小組有個需求上線牽扯9個應用（小組目前維護了26個服務，由於團隊系統業務屬性特徵基於高可用、高性能原則拆分，有些是合理的，有些不是很合理的），同時上週OpsReview的一個微服務濫用典範案例（Promise服務A調用服務B，

2024-05-20 23:55:39

TiDB + ES：转转业财系统亿级数据存储优化实践

以下文章來源於轉轉技術，作者戴美琪導讀本文詳細介紹了轉轉業財系統億級數據存儲優化的實踐。面對系統數據量大、慢查詢多等挑戰，轉轉業財採取了 TiDB 方案優化數據量問題，同時引入 Elasticsearch（ES）解決慢查詢難題。實踐表

2024-05-13 11:16:34

无需重新学习，使用 Kibana 查询/可视化 SLS 数据

作者：荊磊場景現在通過 SLS 的 ES 兼容能力，可以很方便地實現用 Kibana 來查詢和可視化 SLS 的數據。對於從 ES 遷移到 SLS 的用戶可以繼續保留原來的 Kibana 使用習慣。下面來演示如何通過 Kibana 來訪

2024-04-28 21:12:20

日志架构演进：从集中式到分布式的Kubernetes日志策略

當我們沒有使用雲原生方案部署應用時採用的日誌方案往往是 ELK 技術棧。這套技術方案比較成熟，穩定性也很高，所以幾乎成爲了當時的標配。可是隨着我們使用 kubernetes 步入雲原生的時代後， kubernetes 把以往的操作系統

2024-04-23 11:47:10

架构设计｜基于 raft-listener 实现实时同步的主备集群

背景以及需求線上業務對數據庫可用性可靠性要求較高，要求需要有雙 AZ 的主備容災機制。主備集羣要求數據和 schema 信息實時同步，數據同步平均時延要求在 1s 之內，p99 要求在 2s 之內。主備集羣數據要求一致要求能夠在主

2024-04-18 01:07:18

更优性能与性价比，从自建 ELK 迁移到 SLS 开始

作者：荊磊背景 ELK (Elasticsearch、Logstash、Kibana) 是當下開源領域主流的日誌解決方案，在可觀測場景下有比較廣泛的應用。隨着數字化進程加速，機器數據日誌增加，自建 ELK 在面臨大規模數據、查詢性能等方

2024-04-15 21:12:22

美团外卖基于GPU的向量检索系统实践

到家搜索業務具有數據量大、過濾比高等特點，爲了在保證高召回率的同時進一步提高檢索性能，美團到家搜索技術團隊與基礎研發機器學習平臺團隊基於GPU實現了支持向量+標量混合檢索的通用檢索系統，召回率與檢索性能均有較大提升。本文將介紹我們在GPU

2024-04-12 21:15:18

高维解码｜Redis 收紧许可证！开源软件公司如何在云时代生存？

最近，Redis 從開放源代碼的 BSD 許可證過渡到了更加限制性的 Server Side Public License (SSPLv1)。一石激起千層浪，Redis 的這一舉動，不僅分化了前 Redis 維護者，也再次引發業界對於“開

2024-04-08 21:20:20

甲方安全建设之日志采集实操干货

前言沒有永遠的安全，如何在被攻擊的情況下，快速響應和快速溯源分析攻擊動作是個重要的話題。想要分析攻擊者做了什麼、怎麼攻擊進來的、還攻擊了誰，那麼日誌是必不可少的一項，因此我們需要儘可能採集多的日誌來進行分析攻擊者的動作，甚至在攻擊者剛落

2024-04-07 22:46:03

elasticsearch 监控查看活跃的search

GET _nodes/stats indexing 顯示已經索引了多少文檔。這個值是一個累加計數器。在文檔被刪除的時候，數值不會下降。還要注意的是，在發生內部索引操作的時候，這個值也會增加，比如說文檔更新。還列出了索引操作耗費

2024-04-07 13:07:02

阿里云PAI大模型RAG对话系统最佳实践

去年4月至9月，阿里雲人工智能平臺 PAI 團隊與大數據基礎工程技術團隊合作，構建了基於知識庫檢索增強的大模型答疑對話機器人，並在阿里雲官方答疑鏈路、研發小蜜、釘釘大數據技術服務助手等多個線上場景上線，顯著提升答疑效率。相關文檔：【萬字長文

2024-03-15 00:43:34

KubeSphere 社区双周报｜2024.02.29-03.14

KubeSphere 社區雙週報主要整理展示新增的貢獻者名單和證書、新增的講師證書以及兩週內提交過 commit 的貢獻者，並對近期重要的 PR 進行解析，同時還包含了線上/線下活動和佈道推廣等一系列社區動態。本次雙週報涵蓋時間爲：202

2024-03-14 23:29:59

日志服务 SLS 深度解析：拥抱云原生和 AI，基于 SLS 的可观测分析创新

10 月 31 日，杭州雲棲大會上，日誌服務 SLS 研發負責人簡志和產品經理孟威等發表了《日誌服務 SLS 深度解析：擁抱雲原生和 AI，基於 SLS 的可觀測分析創新》的主題演講，對阿里雲日誌服務 SLS 產品服務創新以及背後的技術積累

2023-12-15 01:19:01

云原生网关可观测性综合实践

作者：鈺誠可觀測性可觀測性（Observability）是指系統、應用程序或服務的運行狀態、性能和行爲能夠被有效地監測、理解和調試的能力。隨着系統架構從單體架構到集羣架構再到微服務架構的演進，業務越來越龐大，也越來越複雜。雲原生時代背

2023-10-11 21:14:40

24小時熱門文章

最新文章

最新評論文章