实现WordCount的方法有哪些-快上网网站建设公司

实现WordCount的方法有哪些

这篇文章将为大家详细讲解有关实现WordCount的方法有哪些，文章内容质量较高，因此小编分享给大家做个参考，希望大家阅读完这篇文章后对相关知识有一定的了解。

成都创新互联公司专注于白朗网站建设服务及定制，我们拥有丰富的企业做网站经验。热诚为您提供白朗营销型网站建设，白朗网站制作、白朗网页设计、白朗网站官网定制、重庆小程序开发服务，打造白朗网络公司原创品牌,更为您提供白朗网站排名全网营销落地服务。

1、精简的Shell

cat /home/sev7e0/access.log | tr -s ' ' '\n' | sort | uniq -c | sort -r | awk '{print $2, $1}'
#cat 命令一次性展示出文本内容
#tr -s ' ' '\n' 将文本中空格使用回车键替换
#sort 串联排序所有指定文件并将结果写到标准输出。
#uniq -c 从输入文件或者标准输入中筛选相邻的匹配行并写入到输出文件或标准输出,-c 在每行前加上表示相应行目出现次数的前缀编号
#sort | uniq -c 同时使用用来统计出现的次数
#sort -r 把结果逆序排列
#awk '{print $2,$1}' 将结果输出,文本在前,计数在后

2、反人类的MapReduce

//mapreduce方式
public static void main(String[] args) throws Exception {

    Configuration conf = new Configuration();
//        conf.set("fs.defaultFS", "hdfs://spark01:9000");
//        conf.set("yarn.resourcemanager.hostname", "spark01");

    Path out = new Path(args[1]);
    FileSystem fs = FileSystem.get(conf);

    //判断输出路径是否存在，当路径存在时mapreduce会报错
    if (fs.exists(out)) {
        fs.delete(out, true);
        System.out.println("ouput is exit  will delete");
    }
    
    // 创建任务
    Job job = Job.getInstance(conf, "wordcountDemo");
    // 设置job的主类
    job.setJarByClass(WordCount.class); // 主类

    // 设置作业的输入路径
    FileInputFormat.setInputPaths(job, new Path(args[0]));

    //设置map的相关参数
    job.setMapperClass(WordCountMapper.class);
    job.setMapOutputKeyClass(Text.class);
    job.setMapOutputValueClass(LongWritable.class);
    
    //设置reduce相关参数
    job.setReducerClass(WordCountReduce.class);
    job.setOutputKeyClass(Text.class);
    job.setOutputValueClass(LongWritable.class);

    //设置作业的输出路径
    FileOutputFormat.setOutputPath(job, out);
    job.setNumReduceTasks(2);
    System.exit(job.waitForCompletion(true) ? 0 : 1);
}

3、好用的spark

//spark版wordcount
sc.textFile("/home/sev7e0/access.log").flatMap(_.split(" ")).map((_, 1)).reduceByKey(_+_).foreach(println(_))

关于实现WordCount的方法有哪些就分享到这里了，希望以上内容可以对大家有一定的帮助，可以学到更多知识。如果觉得文章不错，可以把它分享出去让更多的人看到。

分享题目：实现WordCount的方法有哪些
网址分享：http://cdkjz.cn/article/piepje.html

多年建站经验

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

咨询相关问题或预约面谈，可以通过以下方式与我们联系

网站建设

网站推广

案例

方案

电商网站开发

微信小程序

我们

联系

精准传达 • 有效沟通

查看其它板块

实现WordCount的方法有哪些

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

大客户专线成都：13518219792 座机：028-86922220

友情链接交换友情链接

网络推广

Network promotion

网站方案

Solution

电商网站开发

E-commerce & System

我们

About Us

联系

Contact Us

精准传达 • 有效沟通

查看其它板块

实现WordCount的方法有哪些

相关资讯

网站的域名解析怎么实现？

谈论免备案的服务器价格以及服务器的安全问题

域名注册com需要多少钱域名com被注册怎么办

全国拟建电子商务质量大数据应用中心遏制电商售假

社交手机APP开发解决方案

免费域名的申请和注册有哪些局限性？

windows虚拟主机怎么样？如何使用windows虚拟主机？

本地电脑搭建asp网站环境方法是什么？asp语言特点是怎样的？

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

大客户专线 成都：13518219792 座机：028-86922220

友情链接 交换友情链接

大客户专线成都：13518219792 座机：028-86922220

友情链接交换友情链接