当前位置: 首页 > wzjs >正文

白云网站制作泰州seo外包公司

白云网站制作,泰州seo外包公司,如何制作flash网站,学校怎么做网站目录 背景 代码demo 踩坑记录 1、kafka连接器,kafka客户端jar包找不到 2、java模块系统访问限制 3、执行demo任务,一直报错连接kafka topic超时 总结 背景 实际项目中经常遇到source是kafka,需要实时消费kafka某个topic中的数据&#x…

目录

背景

代码demo

 踩坑记录

1、kafka连接器,kafka客户端jar包找不到

2、java模块系统访问限制

3、执行demo任务,一直报错连接kafka topic超时

总结 


背景

        实际项目中经常遇到source是kafka,需要实时消费kafka某个topic中的数据,在此写个demo学习了解。

        环境:本地windows10,python版本3.8.5,pyflink版本1.14.2,kafka版本2.12_2.0.1

代码demo

        代码很简单,在本地启动一个flink任务,消费对端一个kafka的topic,从中取出数据并进行打印,代码如下:

import os
os.environ["_JAVA_OPTIONS"] = "--add-opens=java.base/java.util=ALL-UNNAMED --add-opens=java.base/java.lang=ALL-UNNAMED"from pyflink.datastream import StreamExecutionEnvironment
from pyflink.datastream.connectors import FlinkKafkaConsumer
from pyflink.common.serialization import SimpleStringSchema# 设置执行环境
env = StreamExecutionEnvironment.get_execution_environment()
env.set_parallelism(1)  # 设置并行度
env.add_jars("file:///F:/learn/flinkdemo/flink-connector-kafka_2.12-1.14.2.jar","file:///F:/learn/flinkdemo/kafka-clients-3.6.1.jar")# Kafka 消费者配置
kafka_topic = 'zhubao'
kafka_bootstrap_servers = 'xxx:9092'  # Kafka 服务器地址和端口
consumer = FlinkKafkaConsumer(kafka_topic, SimpleStringSchema(), properties={'bootstrap.servers': kafka_bootstrap_servers,'group.id': 'zhubao-group','auto.offset.reset': 'earliest','session.timeout.ms': '120000','request.timeout.ms': '120000','max.poll.interval.ms': '600000'
})# 将 Kafka 数据源添加到执行环境中
data_stream = env.add_source(consumer)# 数据处理逻辑,例如打印数据
data_stream.print()# 启动执行环境
env.execute("Flink Kafka Consumer Example")

使用kafka客户端生产一些数据,在本地则能实时消费到数据 

在本地终端执行上述flink demo任务,看到相关消费结果 

 踩坑记录

1、kafka连接器,kafka客户端jar包找不到

        上述demo代码中,开头需要在程序运行环境中引入两个jar包,分别是kafka连接器和kafka客户端

env.add_jars("file:///F:/learn/flinkdemo/flink-connector-kafka_2.12-1.14.2.jar","file:///F:/learn/flinkdemo/kafka-clients-3.6.1.jar")

这两个包默认在本地是没有的,需要进行额外的下载,下载地址:

Flink Kafka连接器‌:

  • 下载地址:https://repo.maven.apache.org/maven2/org/apache/flink/flink-connector-kafka_2.12/

Kafka客户端‌:

  • 下载地址:https://repo.maven.apache.org/maven2/org/apache/kafka/kafka-clients/

注意选择对应的版本,我的本地环境是pyflink1.14.2,因此下载的jiar包是对应版本,客户端是3.6.1版本

此外,在add_jars上,需要使用file:///方式,并且最好是绝对路径,否则会报jar包找不到等类似错误

2、java模块系统访问限制

py4j.protocol.Py4JJavaError: An error occurred while calling o10.addSource.
: java.lang.reflect.InaccessibleObjectException: Unable to make field private static final long java.util.Properties.serialVersionUID accessible: module java.base does not "opens java.util" to unnamed module @32cf48b7

        该报错是因为在windows环境Java模块系统(JPMS)的访问限制导致,需通过JVM参数解除模块封装限制。

        解决方法:在程序启动开头,增加JVM启动参数,注意格式,如下:

import os
os.environ["_JAVA_OPTIONS"] = "--add-opens=java.base/java.util=ALL-UNNAMED --add-opens=java.base/java.lang=ALL-UNNAMED"

3、执行demo任务,一直报错连接kafka topic超时

Traceback (most recent call last):File ".\kafkademo.py", line 31, in <module>env.execute("Flink Kafka Consumer Example")File "F:\learn\flinkdemo\venv\lib\site-packages\pyflink\datastream\stream_execution_environment.py", line 691, in executereturn JobExecutionResult(self._j_stream_execution_environment.execute(j_stream_graph))File "F:\learn\flinkdemo\venv\lib\site-packages\py4j\java_gateway.py", line 1285, in __call__return_value = get_return_value(File "F:\learn\flinkdemo\venv\lib\site-packages\pyflink\util\exceptions.py", line 146, in decoreturn f(*a, **kw)File "F:\learn\flinkdemo\venv\lib\site-packages\py4j\protocol.py", line 326, in get_return_valueraise Py4JJavaError(
py4j.protocol.Py4JJavaError: An error occurred while calling o10.execute.
: org.apache.flink.runtime.client.JobExecutionException: Job execution failed....at java.base/java.util.concurrent.ForkJoinPool.runWorker(ForkJoinPool.java:1622)at java.base/java.util.concurrent.ForkJoinWorkerThread.run(ForkJoinWorkerThread.java:165)
Caused by: org.apache.flink.runtime.JobException: Recovery is suppressed by NoRestartBackoffTimeStrategy
...
org.apache.flink.runtime.rpc.akka.AkkaRpcActor.handleMessage(AkkaRpcActor.java:163)at akka.japi.pf.UnitCaseStatement.apply(CaseStatements.scala:24)at akka.japi.pf.UnitCaseStatement.apply(CaseStatements.scala:20)at scala.PartialFunction.applyOrElse(PartialFunction.scala:123)at scala.PartialFunction.applyOrElse$(PartialFunction.scala:122)at akka.japi.pf.UnitCaseStatement.applyOrElse(CaseStatements.scala:20)at scala.PartialFunction$OrElse.applyOrElse(PartialFunction.scala:171)at scala.PartialFunction$OrElse.applyOrElse(PartialFunction.scala:172)at scala.PartialFunction$OrElse.applyOrElse(PartialFunction.scala:172)at akka.actor.Actor.aroundReceive(Actor.scala:537)at akka.actor.Actor.aroundReceive$(Actor.scala:535)at akka.actor.AbstractActor.aroundReceive(AbstractActor.scala:220)at akka.actor.ActorCell.receiveMessage(ActorCell.scala:580)at akka.actor.ActorCell.invoke(ActorCell.scala:548)at akka.dispatch.Mailbox.processMailbox(Mailbox.scala:270)at akka.dispatch.Mailbox.run(Mailbox.scala:231)at akka.dispatch.Mailbox.exec(Mailbox.scala:243)... 5 more
Caused by: org.apache.kafka.common.errors.TimeoutException: Timeout of 60000ms expired before the position for partition zhubao-0 could be determined

        报错信息很长,重点关注最后的

Caused by: org.apache.kafka.common.errors.TimeoutException: Timeout of 60000ms expired before the position for partition zhubao-0 could be determined

        解决方法:尝试对程序增加各种延长超时时间,但都没有啥效果,最后排查寻找发现,是由于本地hosts未配置kafka的域名映射,需要在本地hosts里增加对应映射关系

添加后,问题得以解决

总结 

        该demo很简单,完成在windows环境上使用pyflink进行连接kafka并进行数据消费,主要在windows上并且使用pyflink做开发,遇到一些奇奇怪怪的问题,在此做个记录,方便后续查阅。

http://www.dtcms.com/wzjs/322579.html

相关文章:

  • 如何做网站实现收入稳定产品推广策划方案怎么做
  • amz123余姚seo智能优化
  • 电子商务网站安全性能主要包括百度产品大全入口
  • 宣传京津风筝网站的建设目的怎么自己建立一个网站
  • 视频网站如何做弹幕免费数据分析网站
  • 网站未备案被阻断怎么做英文关键词seo
  • 阿里云服务器的网站备案新媒体运营培训
  • 网站建设的主要特征自己怎样推广呢
  • 云主机 asp 网站宁波seo服务推广
  • 济南莱芜疫情最新消息网站优化外包找谁
  • 门户网站建设实施方案a站
  • 学网站开发顺序东莞网站推广的公司
  • 5款免费网站管理系统百度文库网页版登录入口
  • 梅州哪里做网站bt磁力搜索引擎
  • 八师石河子精神文明建设网站一键优化免费下载
  • 匠王红木在那个网站做众筹网站页面seo
  • 一个空间可以做多少个网站自媒体怎么赚钱
  • 小企业网站建设价格网站seo整站优化
  • 狮岭做包包的网站网络推广公司加盟
  • 家具设计软件下载seo技术介绍
  • 网站的seo 如何优化成都关键词优化报价
  • 项目网站分析seo综合查询系统
  • 成都私人做公司网站的seo整站优化报价
  • 微信对接网站可以做301跳转吗重庆seo职位
  • 教研网站建设方案东莞seo网站优化排名
  • 淄博网站建设团队广告公司业务推广
  • 汉口做网站的公司自己建网站
  • wordpress 客户端网络seo排名
  • 阿里巴巴武汉网站建设目前搜索引擎排名
  • wordpress 3.9 性能长沙网站seo优化