FlinkJoin怎么使用-快上网网站建设公司

FlinkJoin怎么使用

这篇文章主要讲解了“Flink Join怎么使用”，文中的讲解内容简单清晰，易于学习与理解，下面请大家跟着小编的思路慢慢深入，一起来研究和学习“Flink Join怎么使用”吧！

创新互联主要业务有网站营销策划、成都做网站、成都网站设计、成都外贸网站建设、微信公众号开发、小程序开发、HTML5建站、程序开发等业务。一次合作终身朋友，是我们奉行的宗旨；我们不仅仅把客户当客户，还把客户视为我们的合作伙伴，在开展业务的过程中，公司还积累了丰富的行业经验、营销型网站资源和合作伙伴关系资源，并逐渐建立起规范的客户服务和保障体系。

Join算子：两个数据流通过内部相同的key分区，将窗口内两个数据流相同key数据元素计算后，合并输出（类似于MySQL表的inner join操作）

示例环境

java.version: 1.8.x
flink.version: 1.11.1

示例数据源（项目码云下载）

Flink 系例之搭建开发环境与数据

Join.java

package com.flink.examples.functions;

import com.flink.examples.DataSource;
import org.apache.flink.api.common.eventtime.SerializableTimestampAssigner;
import org.apache.flink.api.common.eventtime.WatermarkStrategy;
import org.apache.flink.api.common.functions.FlatJoinFunction;
import org.apache.flink.api.java.functions.KeySelector;
import org.apache.flink.api.java.tuple.Tuple3;
import org.apache.flink.streaming.api.TimeCharacteristic;
import org.apache.flink.streaming.api.datastream.DataStream;
import org.apache.flink.streaming.api.environment.StreamExecutionEnvironment;
import org.apache.flink.streaming.api.windowing.assigners.TumblingEventTimeWindows;
import org.apache.flink.streaming.api.windowing.time.Time;
import org.apache.flink.util.Collector;
import java.time.Duration;
import java.util.Arrays;
import java.util.List;

/**
 * @Description Join算子：两个数据流通过内部相同的key分区，将窗口内两个数据流相同key数据元素计算后，合并输出（类似于mysql表的inner join操作）
 */
public class Join {

    /**
     * Flink支持了两种Join：Window Join（窗口连接）和Interval Join（时间间隔连接），本示例演示的为Window Join
     * 官方文档：https://ci.apache.org/projects/flink/flink-docs-release-1.11/zh/dev/stream/operators/joining.html
     */

    /**
     * 两个数据流集合，对相同key进行内联，分配到同一个窗口下，合并并打印
     * @param args
     * @throws Exception
     */
    public static void main(String[] args) throws Exception {
        final StreamExecutionEnvironment env = StreamExecutionEnvironment.getExecutionEnvironment();
        env.setParallelism(4);
        env.setStreamTimeCharacteristic(TimeCharacteristic.EventTime);
//        //watermark 自动添加水印调度时间
//        env.getConfig().setAutoWatermarkInterval(200);

        List> tuple3List1 = DataSource.getTuple3ToList();
        List> tuple3List2 = Arrays.asList(
                new Tuple3<>("伍七", "girl", 18),
                new Tuple3<>("吴八", "man", 30)
        );

        //Datastream 1
        DataStream> dataStream1 = env.fromCollection(tuple3List1)
                //添加水印窗口,如果不添加，则时间窗口会一直等待水印事件时间，不会执行apply
                .assignTimestampsAndWatermarks(WatermarkStrategy.>forBoundedOutOfOrderness(Duration.ofSeconds(2))
                        .withTimestampAssigner((element, timestamp)->System.currentTimeMillis()));

        //Datastream 2
        DataStream> dataStream2 = env.fromCollection(tuple3List2)
                //添加水印窗口,如果不添加，则时间窗口会一直等待水印事件时间，不会执行apply
                .assignTimestampsAndWatermarks(WatermarkStrategy.>forBoundedOutOfOrderness(Duration.ofSeconds(2))
                        .withTimestampAssigner(new SerializableTimestampAssigner>() {
                            @Override
                            public long extractTimestamp(Tuple3 element, long timestamp) {
                                return System.currentTimeMillis();
                            }
                        }));

        //Datastream 3
        DataStream newDataStream = dataStream1.join(dataStream2)
                .where(new KeySelector, String>() {
                    @Override
                    public String getKey(Tuple3 value) throws Exception {
                        System.out.println("first name:" + value.f0 + ",sex:" + value.f1);
                        return value.f1;
                    }
                })
                .equalTo(new KeySelector, String>() {
                    @Override
                    public String getKey(Tuple3 value) throws Exception {
                        System.out.println("second name:" + value.f0 + ",sex:" + value.f1);
                        return value.f1;
                    }
                })
                .window(TumblingEventTimeWindows.of(Time.seconds(1))
                .apply(new FlatJoinFunction, Tuple3, String>() {
                    @Override
                    public void join(Tuple3 first, Tuple3 second, Collector out) throws Exception {
                        out.collect(first.f0 + "|" + first.f1 + "|" + first.f2 + "|" + second.f0 + "|" + second.f1 + "|" + second.f2);
                    }
                })
            ;
        newDataStream.print();
        env.execute("flink Join job");
    }
}

打印结果

4> 李四|girl|24|伍七|girl|18
4> 刘六|girl|32|伍七|girl|18
4> 伍七|girl|18|伍七|girl|18
2> 张三|man|20|吴八|man|30
2> 王五|man|29|吴八|man|30
2> 吴八|man|30|吴八|man|30

感谢各位的阅读，以上就是“Flink Join怎么使用”的内容了，经过本文的学习后，相信大家对Flink Join怎么使用这一问题有了更深刻的体会，具体使用情况还需要大家实践验证。这里是创新互联，小编将为大家推送更多相关知识点的文章，欢迎关注！

分享名称：FlinkJoin怎么使用
网站链接：http://cdkjz.cn/article/jghcsj.html

多年建站经验

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

咨询相关问题或预约面谈，可以通过以下方式与我们联系

网站建设

网站推广

案例

方案

电商网站开发

微信小程序

我们

联系

精准传达 • 有效沟通

查看其它板块

FlinkJoin怎么使用

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

大客户专线成都：13518219792 座机：028-86922220

友情链接交换友情链接

网络推广

Network promotion

网站方案

Solution

电商网站开发

E-commerce & System

我们

About Us

联系

Contact Us

精准传达 • 有效沟通

查看其它板块

FlinkJoin怎么使用

相关资讯

荀彧的死对司马家族取代曹魏有何影响？

可乐鸡翅要不要先焯水

专业设计网页公司如何选择

今日老茅台酒价格查询「茅台老酒价格表」

蛋糕六寸有多大

域名基础概念

野孩子乐队介绍

电脑双核和四核有什么区别（电脑双核和四核有什么区别吗）

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

大客户专线 成都：13518219792 座机：028-86922220

友情链接 交换友情链接

大客户专线成都：13518219792 座机：028-86922220

友情链接交换友情链接