在远程服务器上使用lambda表达式在spark作业中出现java.lang.ClassCastException错误。

8 浏览2023年6月20日

匿名的 2023年6月21日

0 Comments

我正在尝试使用sparkjava.com框架为我的apache spark作业构建一个Web API。我的代码如下：

@Override
public void init() {
    get("/hello",
            (req, res) -> {
                String sourcePath = "hdfs://spark:54310/input/*";
                SparkConf conf = new SparkConf().setAppName("LineCount");
                conf.setJars(new String[] { "/home/sam/resin-4.0.42/webapps/test.war" });
                File configFile = new File("config.properties");
                String sparkURI = "spark://hamrah:7077";
                conf.setMaster(sparkURI);
                conf.set("spark.driver.allowMultipleContexts", "true");
                JavaSparkContext sc = new JavaSparkContext(conf);
                @SuppressWarnings("resource")
                JavaRDD log = sc.textFile(sourcePath);
                JavaRDD lines = log.filter(x -> {
                    return true;
                });
                return lines.count();
            });
}

如果我删除lambda表达式或将其放在一个简单的jar包中而不是一个Web服务（某种方式是一个servlet），它将可以运行而不会出现任何错误。但是在servlet中使用lambda表达式将导致以下异常：

15/01/28 10:36:33 WARN TaskSetManager: Lost task 0.0 in stage 0.0 (TID 0, hamrah): java.lang.ClassCastException: cannot assign instance of java.lang.invoke.SerializedLambda to field org.apache.spark.api.java.JavaRDD$$anonfun$filter$1.f$1 of type org.apache.spark.api.java.function.Function in instance of org.apache.spark.api.java.JavaRDD$$anonfun$filter$1
at java.io.ObjectStreamClass$FieldReflector.setObjFieldValues(ObjectStreamClass.java:2089)
at java.io.ObjectStreamClass.setObjFieldValues(ObjectStreamClass.java:1261)
at java.io.ObjectInputStream.defaultReadFields(ObjectInputStream.java:1999)
at java.io.ObjectInputStream.readSerialData(ObjectInputStream.java:1918)
at java.io.ObjectInputStream.readOrdinaryObject(ObjectInputStream.java:1801)
at java.io.ObjectInputStream.readObject0(ObjectInputStream.java:1351)
at java.io.ObjectInputStream.defaultReadFields(ObjectInputStream.java:1993)
at java.io.ObjectInputStream.readSerialData(ObjectInputStream.java:1918)
at java.io.ObjectInputStream.readOrdinaryObject(ObjectInputStream.java:1801)
at java.io.ObjectInputStream.readObject0(ObjectInputStream.java:1351)
at java.io.ObjectInputStream.defaultReadFields(ObjectInputStream.java:1993)
at java.io.ObjectInputStream.readSerialData(ObjectInputStream.java:1918)
at java.io.ObjectInputStream.readOrdinaryObject(ObjectInputStream.java:1801)
at java.io.ObjectInputStream.readObject0(ObjectInputStream.java:1351)
at java.io.ObjectInputStream.readObject(ObjectInputStream.java:371)
at org.apache.spark.serializer.JavaDeserializationStream.readObject(JavaSerializer.scala:62)
at org.apache.spark.serializer.JavaSerializerInstance.deserialize(JavaSerializer.scala:87)
at org.apache.spark.scheduler.ResultTask.runTask(ResultTask.scala:57)
at org.apache.spark.scheduler.Task.run(Task.scala:56)
at org.apache.spark.executor.Executor$TaskRunner.run(Executor.scala:196)
at java.util.concurrent.ThreadPoolExecutor.runWorker(ThreadPoolExecutor.java:1142)
at java.util.concurrent.ThreadPoolExecutor$Worker.run(ThreadPoolExecutor.java:617)
at java.lang.Thread.run(Thread.java:745)

附：我尝试了jersey和javaspark与jetty、tomcat和resin的组合，它们都导致了相同的结果。

Apache Spark的这个错误的意义是什么？

Spark Streaming - NoSuchMethodError: scala.collection.immutable.Map$.apply

依赖冲突：Apache Spark 和 Spring Boot

无法从Spark shell打印Hana数据

在WebLogic上引起lang.ClassCastException的冲突是什么？

使用Maven打包和运行Scala Spark项目

Java "target type of lambda conversion must be an interface" 的中文翻译是：Java“lambda转换的目标类型必须是一个接口”。

Apache Spark 主节点 URL 在 Idea IntelliJ 中运行时出错。

在连接到Google BQ时通过spark-submit运行时发生错误。

获取错误：本地类不兼容：流类描述的 serialVersionUID。

执行与hibernate集成的spring mvc程序时发生ClassNotFoundException错误。

当在闭包外调用函数时，只针对类而非对象，会出现无法序列化的错误：java.io.NotSerializableException。

在部署到Apache 7.0.54和Java 8时，Spring上下文初始化失败，出现了java.lang.IllegalArgumentException异常。

构建失败，出现ClassCastException。

java.io.IOException: 在Hadoop的二进制文件中找不到可执行文件 null\bin\winutils.exe。在Windows 7上使用Spark的Eclipse。

Server Tomcat v10.0 Server at localhost failed to start Tomcat v10.0服务器在本地主机上启动失败。

Spark在Windows上 - java.lang.UnsatisfiedLinkError: org.apache.hadoop.io.nativeio.NativeIO$Windows.access0

如何确保我的Apache Spark设置代码只运行一次？

SBT在尝试运行Spark时会出现java.lang.NullPointerException。

当提交一个应用程序时，Spark 报错："在您的配置中必须设置一个主 URL"。

在远程服务器上使用lambda表达式在spark作业中出现java.lang.ClassCastException错误。

0 答案