网站建设 >

查看其它板块

ES聚合学习笔记之--HyperLogLog与BloomFilter

ES的聚合是其一大特色。然而出于性能的考虑， ES的聚合是以分片Shard为单位，而非Index为单位，所以
有些聚合的准确性是需要注意的。比如： TermAggregations.

成都创新互联专业为企业提供荣昌网站建设、荣昌做网站、荣昌网站设计、荣昌网站制作等企业网站建设、网页设计与制作、荣昌企业网站模板建站服务，十年荣昌做网站经验，不只是建网站，更提供有价值的思路和整体网络服务。

es的基数聚合使用到了hyperloglog算法。出于好奇，了解了一下。

在海量数据场景下，我们通常会遇到这样的两个问题:

数据排重。比如在推送消息场景，消息重复对用户是打扰，用户发券场景，重复发券就是损失了。
pv/uv统计。这类场景下，对精确度要求没必要锱铢必较。

如何高效解决这两类问题呢？

对于数据排重，我们可以使用布隆过滤器。java 样列代码如下:

BloomFilter bloomFilter = BloomFilter.create(new Funnel() {

            private static final long serialVersionUID = 1L;

            @Override
            public void funnel(String arg0, PrimitiveSink arg1) {

                arg1.putString(arg0, Charsets.UTF_8);
            }

        }, 1024*1024*32);

        bloomFilter.put("asdf");
        bloomFilter.mightContain("asdf");

对于计数，我们可以使用HyperLogLog算法，ES中已经有相关的实现。

其实封装一下，布隆过滤器也是能直接实现HyperLogLog算法的功能的。

这里遗留几个问题，思考清楚后补充:

BloomFilter跟HyperLogLog算法的原理
相同量级数据下的效率及内存消耗
各自的适用场景有哪些

分享题目：ES聚合学习笔记之--HyperLogLog与BloomFilter
分享地址：http://cdkjz.cn/article/gjoido.html

返回首页了解更多建站资讯

多年建站经验

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

咨询相关问题或预约面谈，可以通过以下方式与我们联系

大客户专线成都：13518219792 座机：028-86922220

在线咨询提交需求

友情链接交换友情链接

成都柴油发电机组青羊总部基地手机网站开发高端网站建设成都小程序定制开发公司网站解决方案 scyanting.com 品牌网站定制创新互联重庆成都未宇聚

成都网站建设公司地址：成都市青羊区太升南路288号锦天国际A座10层建设咨询028-86922220

专家团队为您提供成都网站建设,成都网站设计,成都品牌网站设计,成都营销型网站制作等服务,成都建网站就找快上网！ | 成都网站建设哪家好？ | 网站建设地图

网站建设

网站推广

案例

方案

电商网站开发

微信小程序

我们

联系

精准传达 • 有效沟通

查看其它板块

ES聚合学习笔记之--HyperLogLog与BloomFilter

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

大客户专线成都：13518219792 座机：028-86922220

友情链接交换友情链接

网络推广

Network promotion

网站方案

Solution

电商网站开发

E-commerce & System

我们

About Us

联系

Contact Us

精准传达 • 有效沟通

查看其它板块

ES聚合学习笔记之--HyperLogLog与BloomFilter

相关资讯

哈罗单车押金多少(哈啰出行的押金怎么退)

西安周边游玩景点推荐

极冷温度「极寒天气需要准备什么」

成都网站建设操作中前期准备应放在重要的位置上

今日酿造高粱米价格「酿酒过程」

IT服务向云计算转型服务器行业迎来新的增长点

网站服务器5m带宽在线多少人

手办职业装（做手办）

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

大客户专线 成都：13518219792 座机：028-86922220

友情链接 交换友情链接

大客户专线成都：13518219792 座机：028-86922220

友情链接交换友情链接