当前位置：首页 > news >正文

陕西交通建设集团网站seo合作

news 2026/4/7 17:14:00

陕西交通建设集团网站,seo合作,网站建设服务电话,奢侈品商城网站建设方案这是仿真过程某图： 仿真实战kafka kafka消费sink端和StructuredStreaming集成通信成功 ， 数据接收全部接收数据落地情况： 全部接收到并all存入mysql 下面就简单分享一下StructuredStreaming代码吧 import org.apache.spark.sql.function…

这是仿真过程某图：

kafka消费sink端和StructuredStreaming集成通信成功，数据接收全部接收

数据落地情况：

全部接收到并all存入mysql

下面就简单分享一下StructuredStreaming代码吧

import org.apache.spark.sql.functions.{col, from_json}
import org.apache.spark.sql.streaming.{ OutputMode, Trigger}
import org.apache.spark.sql.types.{IntegerType, StringType,  StructType}
import org.apache.spark.sql.{DataFrame, Dataset, Row, SparkSession}val spark: SparkSession = SparkSession.builder().appName("kafkaConsumer").master("local[3]").getOrCreate()import spark.implicits._// 定义json字段类型格式val Jsonschmea: StructType = new StructType().add("id", dataType = IntegerType).add("name", dataType = StringType).add("sorce", dataType = IntegerType)val message: DataFrame = spark.readStream // message为从kafka读到的原数据.format("kafka").option("kafka.bootstrap.servers", "xxxxx:9092,xxxx:9092,xxxx:9092").option("subscribe", "xxxx").option("startingOffsets", "latest").load()// 将json字符串转化为结构化数据val streamData: DataFrame = message.selectExpr("cast(value as String) as message") .select(from_json($"message", Jsonschmea).alias("data"))// 将json结构化为新的df// 预加载mysql驱动// 实时写入 第二个参数预占位，want给每一批次加入唯一表示， but本次仅占位没有传参数def writeToMysql(batchDF: DataFrame, epochId: Long): Unit = {val sqlurl = "jdbc:mysql://localhost:xxxx/xxxx"val sqluser = "xxxx"val sqlpass = "xxxxx"Class.forName("com.mysql.cj.jdbc.Driver")  // mysql 8.0后得驱动，旧版本去掉cjbatchDF.foreachPartition {partitionOfRecords =>val connection = DriverManager.getConnection(sqlurl, sqluser, sqlpass)// 关闭自动提交以支持增量写入connection.setAutoCommit(false)// 创建预编译的插入语句val insertsql = "insert into jsonstream(id,name,sorce) values(?,?,?)"val preparedStatement = connection.prepareStatement(insertsql)partitionOfRecords.foreach {row =>
//              val id = row.getAs[Int]("data.id")
//              val name = row.getAs[String]("data.name")
//              val score = row.getAs[Int]("data.sorce")val id = row.getAs[Row]("data").getAs[Int]("id")val name = row.getAs[Row]("data").getAs[String]("name")val sorce = row.getAs[Row]("data").getAs[Int]("sorce")// 设置参数到预处理sql函数中preparedStatement.setInt(1, id)preparedStatement.setString(2, name)preparedStatement.setInt(3, sorce)// 执行添加到批次操作preparedStatement.addBatch()}preparedStatement.executeBatch()connection.commit() // 执行批处理后手动提交事务preparedStatement.close()  // 手动GCconnection.close()}}// 数据落地到数据库streamData.writeStream.outputMode(OutputMode.Append()).foreachBatch(writeToMysql _).trigger(Trigger.ProcessingTime("1 millisecond")) // 1 毫秒每个batch.start().awaitTermination()

存储按照一定批次量做存储

友情提示：上述程序是经过脱敏处理的哦

----彩蛋----

如果你看到者你会知道scala在11更新之后也就是12版本如下：

batchDF.foreachPartition {partitionOfRecords => ... 这个位置

Dataset的foreachPartition 里面不能处理 Row的Iterator，所以需要转为rdd在做处理

所以更改后为

batchDF.rdd.foreachPartition { partitionOfRecords => ...

而且这里不能用foreach ，否则无法序列化就能存储到mysql，不能被序列化的数据是不能在网络中进行传输的，通过二进制流的形式传出，在被反序列化回来转化为对象的形式存储

ok -----

查看全文

http://www.hkea.cn/news/665707/

青羊区定制网站建设报价搜索引擎营销方案

淘宝优惠券查询网站怎么做域名备案官网

wordpress自定义url优化教程网下载

模板网站和定制网站百度搜索引擎的网址

企业建设网站公司哪家好app拉新推广接单平台

老虎淘客系统可以做网站吗江西省水文监测中心

poedit pro wordpress免费网站推广优化

市场营销产品推广策划方案seo合作代理

东莞专业网站建设推广搜索引擎网络排名

服务器做网站用什么环境好销售营销方案100例

如何做DJ网站英文seo外链

网站统计源码下载百度推广的步骤

本地网站建设seo推广的方法

东莞好的网站建设效果seo和sem分别是什么

最新版wordpress背景手机网络优化软件

丛台企业做网站推广免费建一级域名网站

集宁网站建设免费网站推广网站破解版

网站建设域名的购买有域名和服务器怎么建网站

深圳有什么网站长沙百度seo

台州企业网站模板建站怎么在百度上做公司网页

烟台网站建设联系企汇互联专业网站维护收费标准

网络客户服务平台搜索优化推广公司

建设网站技术方案线上教育培训机构十大排名

沈阳人流seo优化师就业前景

开发区网站制作公司seo关键词有话要多少钱

相关文章：