Hadoop生态圈-Kafka的本地模式部署

　　　　　　　　　　　　　　　　　　　　Hadoop生态圈-Kafka的本地模式部署

　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　作者：尹正杰

一.Kafka简介

1>.什么是JMS

　　答：在Java中有一个角消息系统的东西，我们叫他Java Message Service，简称JMS。比如各种MQ。

2>.JMS的两种工作模式

　　第一种模式：点到点（point to point,简称P2P），典型的一对一模式（一个人发送数据的同时只有一个人接收数据），也有人称之为端到端（peer to peer）。

　　第二种模式：发布订阅模式（publish subscribe，简称P-S），典型的一对多模式（一个人发送数据的同时可以有多个人接收数据）。

3>.Kafka的工作模式

　　答：Kafka的工作模式可以把JMS的两种模式结合在一起，我们称之为消费者组模式。

4>.什么是Kafka

　　答：Kafka和flume以及Sqoop一样，他们都是中间件（不含有业务的技术组件）。Kafka在官方定义是分布式消息系统。当然Kafka还可以用在做分布式数据库，除此之外，它还可以当做分布式缓存。

5>.ApacheKafka是一个分布式流媒体平台

　　ApacheKafka是一个分布式流媒体平台，这到底是什么意思呢？接下来我们看一下流媒体平台有三个关键功能如下：

　　　　第一：发布和订阅记录流，类似于消息队列或企业消息传递系统。

　　　　第二：以容错持久的方式存储记录流。

　　　　第三：处理记录发生的流。

6>.Kafka通常用于两大类应用

　　第一：构建可在系统或应用程序之间可靠获取数据的实时流数据管道。

　　第二：构建实时流应用程序，用于转换或响应数据流。

7>.kafka版本介绍

　　kafka起先由领英（linkedin创建）公司，开源后被Apache基金会纳入子项目。我们在下载Kafka时，你是如何区分它的版本呢？比如本篇博客下载kafka的版本是“kafka_2.11-1.1.0”，这个“2.11”是scala（java语言脚本化）版本而“1.1.0”是kafka版本。

二.Kafka本地模式部署

1>.下载Kafaka

　　下载地址：http://kafka.apache.org/downloads。

2>.解压并创建软连接

[yinzhengjie@s101 data]$ tar xzf kafka_2.11-1.1.0.tgz -C /soft/

[yinzhengjie@s101 data]$ ln -s /soft/kafka_2.11-1.1.0/ /soft/kafka

[yinzhengjie@s101 data]$

4>.配置环境变量并使之生效

[yinzhengjie@s101 data]$ sudo vi /etc/profile

[sudo] password for yinzhengjie:

[yinzhengjie@s101 data]$

[yinzhengjie@s101 data]$ tail -3 /etc/profile

#ADD KafKa PATH

export KAFKA_HOME=/soft/kafka

PATH=$PATH:$KAFKA_HOME/bin

[yinzhengjie@s101 data]$

[yinzhengjie@s101 data]$ source /etc/profile

[yinzhengjie@s101 data]$

5>.修改配置文件

[yinzhengjie@s101 data]$ sed -i 's@#listeners=PLAINTEXT://:9092@listeners=PLAINTEXT://s101:9092@g' /soft/kafka/config/server.properties

[yinzhengjie@s101 data]$ sed -i 's@log.dirs=/tmp/kafka-logs@log.dirs=/home/yinzhengjie/kafka/logs@g' /soft/kafka/config/server.properties

[yinzhengjie@s101 data]$ sed -i 's@zookeeper.connect=localhost:2181@zookeeper.connect=s102:2181,s103:2181,s104:2181@g' /soft/kafka/config/server.properties

[yinzhengjie@s101 data]$

6>.启动kafka

[yinzhengjie@s101 data]$ kafka-server-start.sh -daemon /soft/kafka/config/server.properties

[yinzhengjie@s101 data]$ echo $?

[yinzhengjie@s101 data]$ jps | grep Kafka

 Kafka

[yinzhengjie@s101 data]$ netstat -untalp | grep

(Not all processes could be identified, non-owned process info

 will not be shown, you would have to be root to see it all.)

tcp6              172.30.100.101:     :::*                    LISTEN      /java

tcp6              172.30.100.101:    172.30.100.101:     ESTABLISHED /java

tcp6              172.30.100.101:     172.30.100.101:    TIME_WAIT   -

tcp6              172.30.100.101:    172.30.100.101:     TIME_WAIT   -

tcp6              172.30.100.101:     172.30.100.101:    ESTABLISHED /java

[yinzhengjie@s101 data]$

[yinzhengjie@s101 data]$

7>.停止kafka

[yinzhengjie@s101 data]$ jps | grep Kafka

 Kafka

[yinzhengjie@s101 data]$ netstat -untalp | grep

(Not all processes could be identified, non-owned process info

 will not be shown, you would have to be root to see it all.)

tcp6              172.30.100.101:     :::*                    LISTEN      /java

tcp6              172.30.100.101:    172.30.100.101:     ESTABLISHED /java

tcp6              172.30.100.101:     172.30.100.101:    TIME_WAIT   -

tcp6              172.30.100.101:    172.30.100.101:     TIME_WAIT   -

tcp6              172.30.100.101:     172.30.100.101:    ESTABLISHED /java

[yinzhengjie@s101 data]$

[yinzhengjie@s101 data]$

[yinzhengjie@s101 data]$

[yinzhengjie@s101 data]$ kafka-server-stop.sh

[yinzhengjie@s101 data]$ jps | grep Kafka

[yinzhengjie@s101 data]$ netstat -untalp | grep

(Not all processes could be identified, non-owned process info

 will not be shown, you would have to be root to see it all.)

tcp6              172.30.100.101:    172.30.100.101:     TIME_WAIT   -

tcp6              172.30.100.101:     172.30.100.101:    TIME_WAIT   -

[yinzhengjie@s101 data]$

[yinzhengjie@s101 data]$

三.kafka初体验

1>.启动kafka（提供服务）

[yinzhengjie@s101 data]$ kafka-server-start.sh -daemon /soft/kafka/config/server.properties

[yinzhengjie@s101 data]$ netstat -untalp | grep

(Not all processes could be identified, non-owned process info

 will not be shown, you would have to be root to see it all.)

tcp6              172.30.100.101:     :::*                    LISTEN      /java

tcp6              172.30.100.101:     172.30.100.101:    ESTABLISHED /java

tcp6              172.30.100.101:    172.30.100.101:     ESTABLISHED /java

[yinzhengjie@s101 data]$ jps | grep Kafka

 Kafka

[yinzhengjie@s101 data]$

[yinzhengjie@s101 data]$ kafka-server-start.sh -daemon /soft/kafka/config/server.properties

2>.创建主题（消息保管者）

[yinzhengjie@s101 data]$ kafka-topics.sh --zookeeper s102: --create  --partitions  --replication-factor   --topic yinzhengjie

Created topic "yinzhengjie".

[yinzhengjie@s101 data]$

[yinzhengjie@s101 data]$ kafka-topics.sh --zookeeper s102:2181 --create --partitions 2 --replication-factor 1 --topic yinzhengjie

3>.启动生产者（消息发送方）

[yinzhengjie@s101 data]$ kafka-console-producer.sh --broker-list s101: --topic yinzhengjie

>My name is yinzhengjie , I love Beijing!

>

[yinzhengjie@s101 data]$ kafka-console-producer.sh --broker-list s101:9092 --topic yinzhengjie

4>.启动消费者（消息接收方）

[yinzhengjie@s101 lib]$ kafka-console-consumer.sh --zookeeper s102: --topic yinzhengjie --from-beginning

Using the ConsoleConsumer with old consumer is deprecated and will be removed in a future major release. Consider using the new consumer by passing [bootstrap-server] instead of [zookeeper].

My name is yinzhengjie , I love Beijing!

[yinzhengjie@s101 lib]$ kafka-console-consumer.sh --zookeeper s102:2181 --topic yinzhengjie --from-beginning

Hadoop生态圈-Kafka的本地模式部署的更多相关文章

Hadoop生态圈-Kafka的完全分布式部署
Hadoop生态圈-Kafka的完全分布式部署作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. 本篇博客主要内容就是搭建Kafka完全分布式,它是在kafka本地模式(https:/ ...
Hadoop生态圈-通过CDH5.15.1部署spark1.6与spark2.3.0的版本兼容运行
Hadoop生态圈-通过CDH5.15.1部署spark1.6与spark2.3.0的版本兼容运行作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. 在我的CDH5.15.1集群中,默 ...
一脸懵逼学习Hadoop分布式集群HA模式部署（七台机器跑集群）
1)集群规划:主机名 IP 安装的软件运行的进程master 192.168.199.130 jdk.hadoop ...
Hadoop生态圈-kafka事务控制以及性能测试
Hadoop生态圈-kafka事务控制以及性能测试作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任.
Hadoop生态圈-Kafka的新API实现生产者-消费者
Hadoop生态圈-Kafka的新API实现生产者-消费者作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任.
Hadoop生态圈-Kafka配置文件详解
Hadoop生态圈-Kafka配置文件详解作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. 一.默认kafka配置文件内容([yinzhengjie@s101 ~]$ more /s ...
Hadoop生态圈-Kafka的旧API实现生产者-消费者
Hadoop生态圈-Kafka的旧API实现生产者-消费者作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. 一.旧API实现生产者-消费者 1>.开启kafka集群 [yinz ...
Hadoop生态圈-Kafka常用命令总结
Hadoop生态圈-Kafka常用命令总结作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. 一.管理Kafka服务的命令 1>.开启kafka服务 [yinzhengjie@s ...
【Hadoop】Hadoop的安装，本地模式、伪分布模式的配置
Download hadoop-2.7.7.tar.gz 下载稳定版本的hadoop-2.7.7.tar.gz(我用的2.6.0,但是官网只能下载2.7.7的了) Required Software ...

随机推荐

Windows下的Anaconda+OpenCV的环境配置
Windows下的Anaconda+OpenCV的环境配置
微信小程序之可滚动视图容器组件 scroll-view
1. 纵向滚动 scroll-y 当设置为scroll-y 时, 需要将其高度设为固定值如果整个页面,即最外层标签为scroll-view,需要并将其高度设为100%,也需要将page设为100% ...
svn插件下载的两种方式
1.下载SVN插件 SVN插件下载地址及更新地址,你根据需要选择你需要的版本.现在最新是1.8.x Links for 1.8.x Release: Eclipse up ...
Microsoft Dynamics CRM 增删改子表汇总子表的某个字段到主表的某个字段（通用插件）
背景经常有某个汇总子表的数量到主表的总数量,或者汇总子表的总价到主表的总价这种需求. 传统的做法: 1.就是为每个子表实体单独写成一个插件,但是这样不好复用. 2.主表的汇总字段是汇总货币类型,但是 ...
Accer 4752G添加固态硬盘双系统
(此文一直在草稿箱里躺了一年,略作修改后发布~) 背景:电脑是2011年年末买的,用到现在也已经5年多了,好在没坏过什么硬件,有过2年疯狂打LOL的经历,之后电脑就打不动了,FPS始终上不去,启动游戏 ...
GitHub 新手教程七，Git GUI 新手教程（4），上传本地代码库到GitHub
1,打开 GitGUI,单击我们之前克隆好的本地库: 2,按图示顺序点击按钮: 3,按图示顺序点击按钮,输入您的 Sign 信息: 4,按图示顺序点击按钮: 5,弹出新的窗口后,点击 “Push” 按 ...
【MOOC EXP】Linux内核分析实验五报告
程涵原创博客 <Linux内核分析>MOOC课程http://mooc.study.163.com/course/USTC-1000029000 分析system_call中断处理过程 ...
第二阶段冲刺——five
个人任务: 王金萱:合并程序(统计团队博客). 季方:合并并排除运行团队博客时出现的错误. 马佳慧:优化登录.注册信息的填写判断. 司宇航:完成打印名单的功能. 站立会议: 任务看板和燃尽图:
UIO,大页内存,CPU亲和性,NUMA机制等
Linux环境下的UIO(Userspace I/O) UIO 用户空间下驱动程序的支持机制.DPDK使用UIO机制使网卡驱动程序运行在用户态,并采用轮询和零拷贝方式从网卡收取报文,提高收发报文的性能 ...
ElasticSearch 2 (27) - 信息聚合系列之故事开始
ElasticSearch 2 (27) - 信息聚合系列之故事开始摘要到目前为止,本书都在着重介绍搜索.对于搜索,我们有查询条件以及与查找到与条件匹配的集合.这个过程就和如大海捞针一样. 对于聚 ...

Hadoop生态圈-Kafka的本地模式部署

Hadoop生态圈-Kafka的本地模式部署的更多相关文章

随机推荐

热门专题