spark集群中slave访问master被拒绝

问题描述

16/04/0923:18:20WARNNativeCodeLoader:Unabletoloadnative-hadooplibraryforyourplatform...usingbuiltin-javaclasseswhereapplicable16/04/0923:18:45ERRORRetryingBlockFetcher:Exceptionwhilebeginningfetchof1outstandingblocksjava.io.IOException:Failedtoconnecttomaster/218.192.172.48:35542atorg.apache.spark.network.client.TransportClientFactory.createClient(TransportClientFactory.java:216)atorg.apache.spark.network.client.TransportClientFactory.createClient(TransportClientFactory.java:167)atorg.apache.spark.network.netty.NettyBlockTransferService$$anon$1.createAndStart(NettyBlockTransferService.scala:91)atorg.apache.spark.network.shuffle.RetryingBlockFetcher.fetchAllOutstanding(RetryingBlockFetcher.java:140)atorg.apache.spark.network.shuffle.RetryingBlockFetcher.start(RetryingBlockFetcher.java:120)atorg.apache.spark.network.netty.NettyBlockTransferService.fetchBlocks(NettyBlockTransferService.scala:100)atorg.apache.spark.storage.ShuffleBlockFetcherIterator.sendRequest(ShuffleBlockFetcherIterator.scala:169)atorg.apache.spark.storage.ShuffleBlockFetcherIterator.fetchUpToMaxBytes(ShuffleBlockFetcherIterator.scala:351)atorg.apache.spark.storage.ShuffleBlockFetcherIterator.initialize(ShuffleBlockFetcherIterator.scala:286)atorg.apache.spark.storage.ShuffleBlockFetcherIterator.<init>(ShuffleBlockFetcherIterator.scala:119)atorg.apache.spark.shuffle.BlockStoreShuffleReader.read(BlockStoreShuffleReader.scala:43)atorg.apache.spark.rdd.ShuffledRDD.compute(ShuffledRDD.scala:98)atorg.apache.spark.rdd.RDD.computeOrReadCheckpoint(RDD.scala:313)atorg.apache.spark.rdd.RDD.iterator(RDD.scala:277)atorg.apache.spark.rdd.MapPartitionsRDD.compute(MapPartitionsRDD.scala:38)atorg.apache.spark.rdd.RDD.computeOrReadCheckpoint(RDD.scala:313)atorg.apache.spark.rdd.RDD.iterator(RDD.scala:277)atorg.apache.spark.rdd.MapPartitionsRDD.compute(MapPartitionsRDD.scala:38)atorg.apache.spark.rdd.RDD.computeOrReadCheckpoint(RDD.scala:313)atorg.apache.spark.rdd.RDD.iterator(RDD.scala:277)atorg.apache.spark.rdd.MapPartitionsRDD.compute(MapPartitionsRDD.scala:38)atorg.apache.spark.rdd.RDD.computeOrReadCheckpoint(RDD.scala:313)atorg.apache.spark.rdd.RDD.iterator(RDD.scala:277)atorg.apache.spark.scheduler.ResultTask.runTask(ResultTask.scala:69)atorg.apache.spark.scheduler.Task.run(Task.scala:82)atorg.apache.spark.executor.Executor$TaskRunner.run(Executor.scala:227)atjava.util.concurrent.ThreadPoolExecutor.runWorker(ThreadPoolExecutor.java:1145)atjava.util.concurrent.ThreadPoolExecutor$Worker.run(ThreadPoolExecutor.java:615)atjava.lang.Thread.run(Thread.java:745)Causedby:java.net.ConnectException:拒绝连接:master/218.192.172.48:35542atsun.nio.ch.SocketChannelImpl.checkConnect(NativeMethod)atsun.nio.ch.SocketChannelImpl.finishConnect(SocketChannelImpl.java:744)atio.netty.channel.socket.nio.NioSocketChannel.doFinishConnect(NioSocketChannel.java:224)atio.netty.channel.nio.AbstractNioChannel$AbstractNioUnsafe.finishConnect(AbstractNioChannel.java:289)atio.netty.channel.nio.NioEventLoop.processSelectedKey(NioEventLoop.java:528)atio.netty.channel.nio.NioEventLoop.processSelectedKeysOptimized(NioEventLoop.java:468)atio.netty.channel.nio.NioEventLoop.processSelectedKeys(NioEventLoop.java:382)atio.netty.channel.nio.NioEventLoop.run(NioEventLoop.java:354)atio.netty.util.concurrent.SingleThreadEventExecutor$2.run(SingleThreadEventExecutor.java:111)...1more16/04/0923:18:50ERRORRetryingBlockFetcher:Exceptionwhilebeginningfetchof1outstandingblocks(after1retries)java.io.IOException:Failedtoconnecttomaster/218.192.172.48:35542atorg.apache.spark.network.client.TransportClientFactory.createClient(TransportClientFactory.java:216)atorg.apache.spark.network.client.TransportClientFactory.createClient(TransportClientFactory.java:167)atorg.apache.spark.network.netty.NettyBlockTransferService$$anon$1.createAndStart(NettyBlockTransferService.scala:91)atorg.apache.spark.network.shuffle.RetryingBlockFetcher.fetchAllOutstanding(RetryingBlockFetcher.java:140)atorg.apache.spark.network.shuffle.RetryingBlockFetcher.access$200(RetryingBlockFetcher.java:43)atorg.apache.spark.network.shuffle.RetryingBlockFetcher$1.run(RetryingBlockFetcher.java:170)atjava.util.concurrent.Executors$RunnableAdapter.call(Executors.java:471)atjava.util.concurrent.FutureTask.run(FutureTask.java:262)atjava.util.concurrent.ThreadPoolExecutor.runWorker(ThreadPoolExecutor.java:1145)atjava.util.concurrent.ThreadPoolExecutor$Worker.run(ThreadPoolExecutor.java:615)atjava.lang.Thread.run(Thread.java:745)Causedby:java.net.ConnectException:拒绝连接:master/218.192.172.48:35542atsun.nio.ch.SocketChannelImpl.checkConnect(NativeMethod)atsun.nio.ch.SocketChannelImpl.finishConnect(SocketChannelImpl.java:744)atio.netty.channel.socket.nio.NioSocketChannel.doFinishConnect(NioSocketChannel.java:224)atio.netty.channel.nio.AbstractNioChannel$AbstractNioUnsafe.finishConnect(AbstractNioChannel.java:289)atio.netty.channel.nio.NioEventLoop.processSelectedKey(NioEventLoop.java:528)atio.netty.channel.nio.NioEventLoop.processSelectedKeysOptimized(NioEventLoop.java:468)atio.netty.channel.nio.NioEventLoop.processSelectedKeys(NioEventLoop.java:382)atio.netty.channel.nio.NioEventLoop.run(NioEventLoop.java:354)atio.netty.util.concurrent.SingleThreadEventExecutor$2.run(SingleThreadEventExecutor.java:111)...1more16/04/0923:18:55ERRORRetryingBlockFetcher:Exceptionwhilebeginningfetchof1outstandingblocks(after2retries)java.io.IOException:Failedtoconnecttomaster/218.192.172.48:35542atorg.apache.spark.network.client.TransportClientFactory.createClient(TransportClientFactory.java:216)atorg.apache.spark.network.client.TransportClientFactory.createClient(TransportClientFactory.java:167)atorg.apache.spark.network.netty.NettyBlockTransferService$$anon$1.createAndStart(NettyBlockTransferService.scala:91)atorg.apache.spark.network.shuffle.RetryingBlockFetcher.fetchAllOutstanding(RetryingBlockFetcher.java:140)atorg.apache.spark.network.shuffle.RetryingBlockFetcher.access$200(RetryingBlockFetcher.java:43)atorg.apache.spark.network.shuffle.RetryingBlockFetcher$1.run(RetryingBlockFetcher.java:170)atjava.util.concurrent.Executors$RunnableAdapter.call(Executors.java:471)atjava.util.concurrent.FutureTask.run(FutureTask.java:262)atjava.util.concurrent.ThreadPoolExecutor.runWorker(ThreadPoolExecutor.java:1145)atjava.util.concurrent.ThreadPoolExecutor$Worker.run(ThreadPoolExecutor.java:615)atjava.lang.Thread.run(Thread.java:745)配置是按照教程：http://wuchong.me/blog/2015/04/04/spark-on-yarn-cluster-deploy/来的，但是始终解决不了这个问题，主从互拼也能拼通，请问各位前辈有遇到过类似情形么，我应该如何排错？其中我把master同时也作为worder，但是master的日志里我也发现了同样的错误.另外，SparkPi的例程却可以运行，而我现在运行的程序在local模式下是没有问题的。

解决方案

解决方案二：
我为master映射了多个ip，然而我发现原来拒绝访问的ip是外网的。这可能是根据hostname来解析的ip，因为在服务器上我不能随便改它
解决方案三：
首先再强调一下环境，我用的是Intellij的IDE，并且已经按照提示在conf/spark_env.sh中设置了SPARK_LOCAL_IP对应着局域网下本机的ip，可是在IDE的环境下仍然提示映射到了外网ip中，从机我设置在了虚拟机上，拒绝访问master也是正常的。然而我发现，在spark-shell的环境下，并没有提示解析到外网ip上，所以我尝试了下用spark-submit提交，拒绝访问的问题就消失了。当然，如果一开始master和对应的hostname是一样的，应该就不会存在拒绝访问的问题，看起来默认就是按照hostname来解析，只是intellij没有读取spark-env.sh中的设置，这是个需要研究的问题。

时间： 2024-08-24 09:50:33

spark集群中slave访问master被拒绝

问题描述

解决方案

spark集群中slave访问master被拒绝的相关文章

spark-java怎么在Spark集群中运行？

【Spark Summit EU 2016】在Spark集群中内置Elasticsearch

Scala-IDE Eclipse（Windows)中开发Spark应用程序，在Ubuntu Spark集群上运行

HBase集群中RegionServer崩溃快速恢复探索

win7下运行的scala程序无法连接到Linux中的spark集群

spark小demo在集群中的流程

集群中IHS无法访问应用

《Spark大数据处理：技术、应用与性能优化》——第2章 Spark集群的安装与部署2.1　Spark的安装与部署

Spark集群安装和使用