Eclipse重写Wordcount类实现处理中文字符,利用hadoop Eclipse插件远程调试hadoop运行WordCount程序

卫衣 / 双肩包 / T 恤/羽绒服等任选,下单送 CSDN 年卡 程序员周边任选一款实物,直接赠送 CSDN 会员年卡+ Coding Plan,写代码学习装备一起拿下 立即抢购


在上面一篇博客中,制作了hadoop 的 Eclipse 插件。现在我们使用Eclipse来重写wordcount统计中文关键词keywords.


1、环境准备。

1、1  准备好有hadoop 插件的Eclipse 

1、2  启动好linux虚拟机

1、3   启动好虚拟机后,需要对  hdfs-site.xml  配置文件  添加一个新的属性:dfs.permissions  为 false。 如下:

<configuration>


<property>
        <name>dfs.replication</name>
        <value>1</value>
</property>


<property>
        <name>dfs.permissions</name>
        <value>false</value>
</property>


</configuration>

保存并退出

1、4  start-all.sh 启动 hadoop。 

1、5  禁用ipatbles 防火墙规则。


2、为linux 添加一个root权限的账户。  该账户名称为你登陆的windwos 的用户名。因为是远程调试,所以需要一个与windows一样的账户名称来运行hadoop。且该账户有足够的权限来运行hadoop。 我直接使用root权限。如下是添加账户示例:(PS: 我 windows 的用户名是 Caixen ,所以以下以 Caixen 为例)


[root@caixen-3 ~]# adduser Caixen       //添加一个名为Caixen的用户

[root@caixen-3 ~]#passwd Caixen       //修改密码


账户添加成功后。给Caixen附 root 权限。

修改 /etc/passwd 文件,找到如下行,把用户ID修改为 0 ,如下所示:


Caixen:x:0:500::/home/Caixen:/bin/bash


保存并退出。


测试Caixen 账户: logout   登出当前用户, 然后使用 Caixen 用户名和密码登陆即可。


3、在Eclipse 中新建一个  MapReduce Driver 项目,取名为:KeyWordCount


3、1   在hadoop-1.2.1 原解压文件中找到 WordCount.java 文件,并拷贝到 KeyWordCount 项目中。 

  WordCount.java 文件路径是:hadoop-1.2.1\src\examples\org\apache\hadoop\examples


3、2   新建一个Class: Ejob .java   整个类代码如下:

public class EJob {


    // To declare global field
    private static List<URL> classPath = new ArrayList<URL>();


    // To declare method
    public static File createTempJar(String root) throws IOException {
        if (!new File(root).exists()) {
            return null;
        }
        Manifest manifest = new Manifest();
        manifest.getMainAttributes().putValue("Manifest-Version", "1.0");
        final File jarFile = File.createTempFile("EJob-", ".jar", new File(
                System.getProperty("java.io.tmpdir")));


        Runtime.getRuntime().addShutdownHook(new Thread() {
            public void run() {
                jarFile.delete();
            }
        });


        JarOutputStream out = new JarOutputStream(
                new FileOutputStream(jarFile), manifest);
        createTempJarInner(out, new File(root), "");
        out.flush();
        out.close();
        return jarFile;
    }


    private static void createTempJarInner(JarOutputStream out, File f,
            String base) throws IOException {
        if (f.isDirectory()) {
            File[] fl = f.listFiles();
            if (base.length() > 0) {
                base = base + "/";
            }
            for (int i = 0; i < fl.length; i++) {
                createTempJarInner(out, fl[i], base + fl[i].getName());
            }
        } else {
            out.putNextEntry(new JarEntry(base));
            FileInputStream in = new FileInputStream(f);
            byte[] buffer = new byte[1024];
            int n = in.read(buffer);
        &n

IDEA(2019.3)远程调试HADOOP(2.7.1)配置过程:WordCount实例 目的:在Idea上直接调试虚拟机中的HDFS,执行MapReduce,不需要将jar包上传到hadoop目录下再运行 配置环境: 虚拟机 hadoop 2.7.1 本地 hadoop 2.7.1 IDEA 版本 2019.3.3 Maven 3.6.3 1. 修改虚拟机hadoop的etc/hadoop/core-site.xml 需要修改为hdfs://IP地址:9000 (主机名也可以,如果使用IP地址建议将IP地址设置为静态IP) 2. 使用xftp 等工具将HADOOP etc/hadoop目录下 阅读详情

相关推荐

大数据之-Hadoop3.x_MapReduce_WordCount案例_Debug调试---大数据之hadoop3.x工作笔记0092

前面几节,我们已经把WordCount这个MapReduce程序用java写完了,然后现在我们来执行调试一下. 我们首先走到这个WordCountDriver程序中,然后开始执行 run WordCountDriver.main()方法 执行以后,可以看到结果,有了 上面那两个crc文件我们先不用管是用来做校验的 这个_SUCCESS可以看到大小是0,也不用管,其实就是用来告诉我们执行成功了的 然后这个part_00000 这个文件就是结果文件 可以看到这里:...

添柴程序猿的专栏 603

使用java API操纵打印机

使用java API操纵打印机 包含图形解面和源码

java打印功能开发手册

Java高级编程教程: 打印,java打印功能开发手册pdf,学习如何使用打印服务API-Learn how to use the Print Service API,解释了如何一步一步的定位打印设备,创建打印工程,创建一个Doc 接口的实例,以此来描述你想要打印的数据并且初始化打樱

IDEA调试运行基于hadoopWordCount项目

IDEA调试运行hadoop 创建一个WordCount项目 创建一个com.lyf.wordcount包 1.修改maven pom.xml //配置打包方式 <packaging>jar</packaging> //配置依赖jar包 <dependency> <groupId>org.apache.hadoop<...

weixin_43343486的博客 705

使用JNative对条码打印机进行打印

 因项目需要,对Godex  EZ2300条码机进行调用打印, 驱动为Ez2000.dll, 用JNI可以实现调用,但比较麻烦, 需要用到VC6进行DLL封装,改用JNative组件进行调用, 步骤如下:1. 下载JNative-1.3.2.zip组件库2. 解压出来后有JNative.jar  /  JNativeCpp.dll  /  libJNativeCpp.so三个文件,

琉璃仙境 2045

Godex条码打印机(EZ-PL打印语言)集成开发小结

Godex条码打印机 以EZ-1100p为例,使用简单可靠,集成开发也比较方便。   EZ-1100p系列是热转印式打印机,需要使用碳带(最大长度300M),支持输出条码标签至卷纸带(不干胶)上。对一般如图书馆、档案室、生鲜超市、工业制造、日常办公的打印条码需求非常适用,只要不是户外、野外、船舶等保存性、耐磨损要求高的专用特殊场合,都是不错的选择。 打印精度较高,条码枪识别容易,耗材便宜,经济...

explorer 1715

在Windos上使用Eclipse进行Hadoop开发的环境搭建

使用eclipsehadoop开发环境搭建 1.准备 1.1 完成linux上的hadoop集群安装,并且能够从WIN上远程到linux 如果你还未完成安装集群可以参考我的这篇博文(注意是基于Mesos的) 《基于集群资源管理器Mesos的Hadoop安装教程地址》 1.2 在你的本机上也安装好JDK和Eclipse   我本机使用的Java版本是1.7的 JDK1.7...

weixin_34254823的博客 102

java godex500_科诚 Godex 打印机驱动下载

科诚Godex 打印机驱动下载环境支持:Windows Vista、Windows 7、Windows 8 和 Windows 10 的所有版本。Windows Server 2008、2008 R2、2012, 2012 R2 和 2016。32 位和 64 位 (x64) 版本。支持打印机型号:Godex BP500LGodex BP500L GEPLGodex BP500L GZPLGode...

weixin_34335039的博客 2万+

作业:WordCount--实现字符数,单词数,行数的统计

1. Gitee 地址 https://gitee.com/fyxiaobai/wordcount 2. PSP表格 PSP2.1 PSP阶段 预估耗时 (分钟) 实际耗时 (分钟) Planning 计划 30 25 · Estimate · 估计...

weixin_30256505的博客 973

Godex是Godot Engine ECS库。-C/C++开发

Godex是Godot Engine ECS库。 Godex Godex是Godot Engine ecs库。 免责声明:此模块仍在开发中,如果需要帮助,请打开一个问题以报告任何问题或进行新的讨论。 欢迎任何形式的贡献。 ECS简称ECS,实体组件系统是一种体系结构设计模式,允许以某种方式组织数据,以便可以将工作负载拆分为小型而简单的程序。 Wiki可以使用Wiki。 有用的链接:编译。

GoDEX标签打印机开发C# Java VB C++ 实例代码

GoDEX标签打印机开发C# Java VB C++ 实例代码 全面的实例 相关pdf请移步我的其他资源

科诚(GoDex)打印机二次开发Demo

二次开发的例子,有C#、VB.NET、VC、dephi等

Brother 打印机集成开发总结

[搬家贴] 作者: explorer 邮箱: explorer.MT@Gmail.com 主页: http://blog.csdn.net/explorer_MT 发布: 2010-02-23   对Brother 条码标签打印机集成开发,主要涉及两个概念:1. P-touch Editor 这个是标签设计软件,用于设计标签的样式、内容、格式。用法似 Fas...

explorer 1734

hadoop wordcount 调试

第一次安装hadoop,跑wordcount,遇到不少问题,在这里总结一下我遇到的怪异问题和我的解决方法。 第一。hadoop命令不能使用   要使用hadoop命令,得在/etc/profile 里面添加 HADOOP_HOME. 个人怀疑在conf/hadoop-env.sh里面配置直也可以,但是没有试验,以后再验证。 export HADOOP_HOME_W

Rudyee的专栏 1067

Linux 单词计数 WordCount 以及代码案例

WordCount 首先是命令行的:             WordCount(单词计数) 1:启动hadoop 使用 start-all.sh 命令启动hdfs   2:在hadoop的安装目录下新建一个目录,使用hdfs的shell命令 cd /usr/local/hadoop-2.8.0 切换目录 hdfs fs -mkdir /input   3:h

qq_36074043的博客 2121

【太阳能多级逆变器】具有较低的总谐波失真(THD),并采用了SPWM(正弦脉宽调制)技术研究(Simulink仿真实现

内容概要:本文研究了一种应用于太阳能发电系统的多级逆变器,旨在通过采用正弦脉宽调制(SPWM)技术有效降低输出电压的总谐波失真(THD),从而提升电能质量。研究基于Simulink平台构建了完整的仿真模型,系统地实现了SPWM信号生成、驱动逻辑控制以及多电平输出波形合成等关键环节,验证了该多级逆变器在不同运行工况下具备优异的动态响应能力和稳定性。仿真结果表明,所设计的逆变器能够输出接近理想正弦波的电压波形,显著抑制高次谐波,满足可再生能源并网对电能质量的严苛要求,体现出多级逆变拓扑在光伏发电系统中的技术先进性与工程应用价值。; 适合人群:电气工程、自动化、新能源科学与工程及相关专业的本科生、研究生,以及从事光伏逆变器设计、电力电子变换技术和可再生能源并网系统研发的工程技术人员。; 使用场景及目标:①深入理解多级逆变器的工作原理及其在太阳能发电系统中的关键作用;②掌握SPWM调制技术的理论基础与实现方法,并分析其对改善THD的核心机制;③借助Simulink仿真平台开展电力电子电路的建模、参数调试与性能评估,服务于课程设计、毕业设计、科研课题或实际工程项目开发。; 阅读建议:建议读者结合提供的Simulink仿真模型进行同步操作与验证,细致调整调制比、载波频率等关键参数,观察其对输出波形和THD指标的影响,以深化对系统动态特性的理解,并尝试优化控制策略以进一步提升系统性能。

上一篇: hadoop-1.2.1在Eclipse中编译插件,实现Eclipse远程连接hadoop
下一篇: MapReduce简单介绍
caixen
博客等级 码龄12年 0粉丝 14原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值