快捷導(dǎo)航

pyspark連接mysql數(shù)據(jù)庫報錯的解決

更新時間：2023年11月07日 08:59:34 作者：猿界零零七

本文主要介紹了pyspark連接mysql數(shù)據(jù)庫報錯的解決,因為spark中缺少連接MySQL的驅(qū)動程序,下面就來介紹一下解決方法,感興趣的可以了解一下

使用pyspark連接mysql數(shù)據(jù)庫代碼如下

spark_conf = SparkConf().setAppName("MyApp").setMaster("local")
 
spark = SparkSession.builder.config(conf=spark_conf).getOrCreate()
 
url = "jdbc:mysql://localhost:3306/test?useUnicode=true&characterEncoding=UTF-8&useSSL=false"
table_name = "tab_tf"
properties = {
    "user": "root",
    "password": "root"
}
 
# 讀取 MySQL 數(shù)據(jù)庫中的數(shù)據(jù)
df = spark.read.jdbc(url=url, table=table_name, properties=properties)
# 展示數(shù)據(jù)
df.show()

執(zhí)行時報錯了，錯誤信息如下：

py4j.protocol.Py4JJavaError: An error occurred while calling o32.jdbc.
: java.sql.SQLException: No suitable driver
   at java.sql.DriverManager.getDriver(DriverManager.java:315)
   at org.apache.spark.sql.execution.datasources.jdbc.JDBCOptions$$anonfun$6.apply(JDBCOptions.scala:105)
   at org.apache.spark.sql.execution.datasources.jdbc.JDBCOptions$$anonfun$6.apply(JDBCOptions.scala:105)
   at scala.Option.getOrElse(Option.scala:121)
   at org.apache.spark.sql.execution.datasources.jdbc.JDBCOptions.<init>(JDBCOptions.scala:104)
   at org.apache.spark.sql.execution.datasources.jdbc.JDBCOptions.<init>(JDBCOptions.scala:35)
   at org.apache.spark.sql.execution.datasources.jdbc.JdbcRelationProvider.createRelation(JdbcRelationProvider.scala:32)
   at org.apache.spark.sql.execution.datasources.DataSource.resolveRelation(DataSource.scala:332)
   at org.apache.spark.sql.DataFrameReader.loadV1Source(DataFrameReader.scala:242)
   at org.apache.spark.sql.DataFrameReader.load(DataFrameReader.scala:230)
   at org.apache.spark.sql.DataFrameReader.load(DataFrameReader.scala:186)
   at org.apache.spark.sql.DataFrameReader.jdbc(DataFrameReader.scala:257)
   at sun.reflect.NativeMethodAccessorImpl.invoke0(Native Method)
   at sun.reflect.NativeMethodAccessorImpl.invoke(NativeMethodAccessorImpl.java:62)
   at sun.reflect.DelegatingMethodAccessorImpl.invoke(DelegatingMethodAccessorImpl.java:43)
   at java.lang.reflect.Method.invoke(Method.java:498)
   at py4j.reflection.MethodInvoker.invoke(MethodInvoker.java:244)
   at py4j.reflection.ReflectionEngine.invoke(ReflectionEngine.java:357)
   at py4j.Gateway.invoke(Gateway.java:282)
   at py4j.commands.AbstractCommand.invokeMethod(AbstractCommand.java:132)
   at py4j.commands.CallCommand.execute(CallCommand.java:79)
   at py4j.GatewayConnection.run(GatewayConnection.java:238)
   at java.lang.Thread.run(Thread.java:748)