关于MySQL导入数据到elasticsearch的小工具logstash

logstash核心配置文件pipelines.yml

 #注:此处的 - 必须顶格写必须！！！

 - pipeline.id: invitation

 #下面路径配置的是你同步数据是的字段映射关系

   path.config: /opt/apps/logstash/config/invitation/invitation.conf

同步数据时的字段映射关系配置文件invitation.conf。注：路径一定跟你pipelines.yml配置文件中的一样

 input {

 jdbc {

 #驱动jar包的位置

 jdbc_driver_library => "/opt/apps/logstash/lib/mysql-connector-java-8.0.13.jar"

 #驱动类名

 jdbc_driver_class => "com.mysql.cj.jdbc.Driver"

 #MySQL的链接

 jdbc_connection_string => "jdbc:mysql://192.168.0.234:3306/community?characterEncoding=utf8&useSSL=false&serverTimezone=UTC&rewriteBatchedStatements=true"

 #数据库用户名

 jdbc_user => "mostchh"

 #数据库密码

 jdbc_password => "1qaz2wsx3edc"

 #数据库重连尝试次数

 connection_retry_attempts => "3"

 #超时时间

 jdbc_validation_timeout => "3600"

 #开启分页查询（默认false不开启）

 jdbc_paging_enabled => "true"

 #单次分页查询条数（默认100000,若字段较多且更新频率较高，建议调低此值）

 jdbc_page_size => "500"

 #时区

 #jdbc_default_timezone =>"Asia/Shanghai"

 #如果sql较复杂，建议配通过statement_filepath配置sql文件的存放路径；

 statement_filepath => "/opt/apps/logstash/sql/invitation/invitation.sql"

 #需要记录查询结果某字段的值时，此字段为true

 use_column_value => true

 #是否设置字段为小写，默认是true

 lowercase_column_names => false

 #需要记录的递增字段，用于增量同步，下次只同步比该值大的数据

 tracking_column => "modifiedTime"

 #递增的字段类型

 tracking_column_type => "timestamp"

 #记录上一次运行记录

 record_last_run => true

 #上一次同步的递增字段存放文件路径

 last_run_metadata_path => "/opt/apps/logstash/station/invitation.txt"

 #是否清除last_run_metadata_path的记录，需要增量同步时此字段必须为false

 clean_run => false

 #自动同步数据的cron表达式，下面是一秒执行一次

 schedule => "*/1 * * * * *"

 #对应你pipelines配置文件的ID

 type => "invitation"

 }

 }

 #数据处理的过滤器

 filter {

 aggregate {

 task_id => "%{cardId}"

 code => "

 	map['cardId'] = event.get('cardId')

 	map['title'] = event.get('title')

                 map['content'] = event.get('content')

                 map['issueUserId'] = event.get('issueUserId')

                 map['issueUserName'] = event.get('issueUserName')

                 map['issueUserIcon'] = event.get('issueUserIcon')

 	map['issueTime'] = event.get('issueTime')

 	map['revealStatus'] = event.get('revealStatus')

                 map['commentNum'] = event.get('commentNum')

                 map['isMeLike'] = event.get('isMeLike')

                 map['giveLikeNum'] = event.get('giveLikeNum')

                 map['isDelete'] = event.get('isDelete')

 				map['issueStatus'] = event.get('issueStatus')

 				map['cardStatus'] = event.get('cardStatus')

 	map['giveLikeUsers'] ||=[]

 	#数据一对多的处理

 	if (event.get('userId') != nil)

 		if !(map['giveLikeUsers'].include? event.get('userId'))

 			map['giveLikeUsers'] << event.get('userId')

 		end

 	end

 	map['file_list'] ||=[]

 	map['fileList'] ||=[]

 	#数据一对多的处理

 	if (event.get('fileId') != nil)

 		if !(map['file_list'].include? event.get('fileId'))

 			map['file_list'] << event.get('fileId')

 			map['fileList'] << {

 				'fileId' => event.get('fileId'),

 				'fileName' => event.get('fileName'),

 				'fileUrl' => event.get('fileUrl')

 			}

 		end

 	end

 	event.cancel()

 "

 push_previous_map_as_event => true

 timeout => 5

 }

 mutate {

 }

  mutate {

  #过滤不需要的字段

remove_field => ["@timestamp","@version"]

 }

 }

 output {

 elasticsearch {

document_id => "%{cardId}"

document_type => "_doc"

index => "bbs_card_management"

hosts => ["http://192.168.0.178:9200"]

  }

 stdout{

codec => rubydebug

 }

 }

同步数据的SQL配置文件invitation.sql，具体的SQL就根据你的业务来定了，我这里用的视图所以SQL比较简单。注：路径一定跟你invitation.conf配置文件中的一样
```
 SELECT

 *

 FROM

 invitation

 WHERE

 modifiedTime >= :sql_last_value

 AND modifiedTime < NOW()
```
此处的:sql_last_value 取得就是你递增字段存放地址中的值
递增字段存放文件invitation.txt。注：路径一定跟你invitation.conf配置文件中的一样
```
 --- 2021-08-30 15:22:08.000000000 +00:00
```
配置的存放类型是时间类型，存储格式就是这样的。

以上就是logstash的所有配置了，只需要运行即可实现一秒同步一次数据，当然具体多久同步根据你具体的需求来定。

关于MySQL导入数据到elasticsearch的小工具logstash的更多相关文章

安装配置elasticsearch、安装elasticsearch-analysis-ik插件、mysql导入数据到elasticsearch、安装yii2-elasticsearch及使用
一.安装elasticsearch 获取elasticsearch的rpm:wget https://download.elastic.co/elasticsearch/release/org/ela ...
使用Sqoop从MySQL导入数据到Hive和HBase 及近期感悟
使用Sqoop从MySQL导入数据到Hive和HBase 及近期感悟 Sqoop 大数据 Hive HBase ETL 使用Sqoop从MySQL导入数据到Hive和HBase 及近期感悟基础环境 ...
教程 | 使用Sqoop从MySQL导入数据到Hive和HBase
基础环境 sqoop:sqoop-1.4.5+cdh5.3.6+78, hive:hive-0.13.1+cdh5.3.6+397, hbase:hbase-0.98.6+cdh5.3.6+115 S ...
mysql导入数据到oracle中
mysql导入数据到oracle中. 建立Oracle表: CREATE TABLE "GG_USER" ( "USERID" BYTE) NOT NULL, ...
mysql导入数据load data infile用法
mysql导入数据load data infile用法基本语法: load data [low_priority] [local] infile 'file_name txt' [replace | ...
elasticsearch -- Logstash实现mysql同步数据到elasticsearch
配置安装插件由于这里是从mysql同步数据到elasticsearch,所以需要安装jdbc的入插件和elasticsearch的出插件:logstash-input-jdbc.logstash-o ...
使用sqoop从mysql导入数据到hive
目录前言一.使用的导入命令二.遇到的问题及解决 1. 用文本字段进行分区的问题 2. Hadoop历史服务器Hadoop JobHistory没开启的问题 3. 连接元数据存储数据库报错 4 ...
MYSQL导入数据出现The MySQL server is running with the --secure-file-priv
MYSQL导入数据出现The MySQL server is running with the --secure-file-priv option so it cannot execute this ...
MySQL导入数据遇到Error Number: 1467 Failed to read auto-increment value from storage engine错误
MySQL导入数据遇到Error Number: 1467 Failed to read auto-increment value from storage engine错误创建表的语句 CREAT ...

随机推荐

spring cloud 通过 ribbon 实现客户端请求的负载均衡（入门级）
项目结构环境: idea:2020.1 版 jdk:8 maven:3.6.2 1. 搭建项目 ( 1 )父工程:spring_cloud_demo_parent pom 文件 <?xml v ...
【Java 多线程】Java线程池类ThreadPoolExecutor、ScheduledThreadPoolExecutor及Executors工厂类
Java中的线程池类有两个,分别是:ThreadPoolExecutor和ScheduledThreadPoolExecutor,这两个类都继承自ExecutorService.利用这两个类,可以创建 ...
SpringColud微服务-微服务概述
一.什么是微服务架构微服务架构是一种架构模式,它提倡讲单一应用程序划分为一组小的服务,服务之间互相协调.互相配合,为用户提供最终价值.每个服务运行在单独的进程当中,服务与服务之间采用轻量级的通信机制 ...
HTML DOM 对象 - 方法和属性
一些常用的 HTML DOM 方法: getElementById(id) - 获取带有指定 id 的节点(元素) appendChild(node) - 插入新的子节点(元素) removeChil ...
ANTLR 简介
<ANTLR 4权威指南>由机械工业出版社出版,有兴趣的读者推荐购买阅读. 本专题大多内容来源于我读<ANTLR 4权威指南>的随手笔记以及个人实践,仅供参考学习,请勿用于任何 ...
Java动态脚本Groovy读取配置文件
前言:请各大网友尊重本人原创知识分享,谨记本人博客:南国以南i 核心涉及: @Value:作用是通过注解将常量.配置文件中的值.其他bean的属性值注入到变量中,作为变量的初始值. @Configur ...
Linux_ShellCode总结
在寄存器都是非理想值情况下(shellcode可根据环境具体触发时寄存器的值做长度调整),我本着最优通用的原则,整理了Linux下32位和64位最短通用shellcode的编写. 32位有" ...
List.Sum…统计信息（Power Query 之 M 语言）
数据源: 任意数据源,一列数值,一列非数值(文本) 目标: 对数值列进行求和等计算,对非数值列进行计数等计算操作过程: 选取待计算的列>[转换]>[统计信息]>选取 M公式: ...
预算（Project）
<Project2016 企业项目管理实践>张会斌董方好编著预算是件重要的事,不然银几一花没边了,那结果可是要牺牺的(以下省略具体描述9^323字) 在Project里做预算,步骤不 ...
Lookup函数（Excel函数集团）
此处文章均为本妖原创,供下载.学习.探讨! 文章下载源是Office365国内版1Driver,如有链接问题请联系我. 请勿用于商业!谢谢下载地址:https://officecommunity-m ...

关于MySQL导入数据到elasticsearch的小工具logstash

关于MySQL导入数据到elasticsearch的小工具logstash的更多相关文章

随机推荐

热门专题