腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
Spark
集群
模式
&
线程
apache-spark
、
hadoop-yarn
我正在从一个网关启动一个带有--master yarn --deploy-mode cluster选项的
spark
应用程序(2.1.0),它采用yarn
集群
模式
。然而,我看到
spark
-submit在网关上启动的进程仍然在本地创建了数百个
线程
。我希望
线程
是在工作节点上创建的,而不是在网关中创建的,因为
集群
模式
是激活的。
集群
模式
由日志确认。为什么会有数百个
线程
在网关中被启动? PS:我使用的是运行Ha
浏览 15
提问于2017-08-30
得票数 0
6
回答
setMaster‘`local[*]’在
spark
中是什么意思?
scala
、
apache-spark
我找到了一些在本地启动
spark
的代码:val ctx = new
浏览 3
提问于2015-09-02
得票数 68
1
回答
在单个机器上设置带有火花放电的任务槽
apache-spark
、
pyspark
、
hyperopt
接受
spark
_session作为一个论点,理论上它是我设置核数目的地方。谢谢!import linear_model, datasets, model_selectionfrom pyspark.sql import SparkSession
spark
= SparkSession.builder.master("local").config('
spark
.local.dir', './').config("
浏览 5
提问于2020-11-02
得票数 0
回答已采纳
1
回答
SPARK
_WORKER_CORES设置对火花单机并发性的影响
apache-spark
、
streaming
、
distributed-computing
、
apache-spark-standalone
我使用的是以独立
模式
配置的
Spark
2.2.0
集群
。
集群
有2台八位数核心机器。此群集只用于火花作业,没有其他进程使用它们。我有大约8个星火流应用程序运行在这个
集群
上。我显式地将
SPARK
_WORKER_CORES (在
Spark
-env.sh中)设置为8,并使用全执行器核心设置为每个应用分配一个核心。此配置减少了并行处理多个任务的能力。我想让
Spark
做的是为每个作业和进程并行启动单独的
线程
。但是我找不到一个单独的火花设置来控制<em
浏览 0
提问于2018-01-29
得票数 1
回答已采纳
3
回答
在Apache
Spark
中提交申请
java
、
apache-spark
我是Apache
Spark
的新手,正在尝试创建一个简单的应用程序来在本地
模式
下运行它,我意识到它有像
spark
-submit这样的脚本来提交应用程序。请告诉我在
Spark
中对应的API。感谢在这方面的帮助。谢谢。
浏览 3
提问于2016-09-20
得票数 1
1
回答
在
spark
独立
模式
下,主程序和执行器是否位于同一台机器上?
apache-spark
、
apache-spark-standalone
spark
独立
模式
是否意味着执行器和主控器在同一台机器上运行?如果是,它如何参与并行性。是否将
spark
conf的本地函数设置为独立
模式
时传递的值,以指示
spark
应用程序在单机上运行?
浏览 2
提问于2019-08-17
得票数 0
1
回答
Apache
Spark
无法在亚马逊EC2上使用
spark
-submit脚本连接到主服务器
apache-spark
、
amazon-ec2
首先,我使用
spark
-ec2脚本在EC2上设置了一个包含一个主节点和一个工作节点的
Spark
集群
。在我使用ssh连接到我的EC2主实例之后,我想运行
spark
-submit脚本,这样我就可以运行我自己的
Spark
Code了。我首先上传我的.jar文件,然后使用脚本。为此,我使用以下命令:--mas
浏览 3
提问于2016-08-02
得票数 0
回答已采纳
1
回答
原因: java.lang.ClassCastException:无法将java.lang.invoke.SerializedLambda的实例分配给字段org.apache.
spark
.api.java.JavaRDDLike
java
、
eclipse
、
apache-spark
在前者中,
Spark
的主人是本地化的。Path ############export
SPARK
_SUBMIT=/home/m_usr/
spark
-2.2.0-bin-hadoop2.7/bin/
spark
-submit export PATH=$PATH:$
SPARK
_HOME
浏览 2
提问于2017-10-08
得票数 0
0
回答
在一个主
spark
作业中启动多个
spark
作业
hadoop
、
apache-spark
是否可以在一个主
spark
作业中产生多个
spark
作业,我的主
spark
作业的驱动程序是在纱线
集群
上启动的,它将进行一些预处理,并基于它需要在纱线
集群
上启动多个
spark
作业。不确定这个
模式
是否正确。 主
spark
作业将启动其他
spark
-job,类似于在
Spark
驱动程序中调用多个
spark
-submit。这些为新任务生成的
线程
将是完全不同的组件,因此不能使用
spark<
浏览 5
提问于2016-12-21
得票数 2
3
回答
如何在本地
模式
下更改执行程序的数量?
scala
、
apache-spark
、
spark-streaming
是否可以使用某些
Spark
设置在本地
模式
下为
Spark
流应用程序设置多个执行器?目前,当我将
spark
.executor.instances参数更改为4时,我无法看到
Spark
在性能或执行器数量上有任何变化。
浏览 3
提问于2018-09-05
得票数 8
回答已采纳
4
回答
可以从代码中运行
spark
yarn
集群
吗?
java
、
apache-spark
、
hadoop-yarn
我有一个MapReduce任务,我想从我的java代码中在
Spark
YARN
集群
上运行它。我还想在java代码中检索reduce结果(字符串和数字对、元组)。()); String max = results.max(new MyResultsComparator())._1(); 如果将master设置为local、local[]或
spark
浏览 0
提问于2016-02-20
得票数 5
1
回答
无法在Yarn群集
模式
下运行Talend作业
apache-spark
、
talend
流程:主作业-> BigData
Spark
job1纱线
模式
:客户端主作业-> BigData
spark
job2纱线
模式
:
集群
job1和job2是一样的,只是yarn部署
模式
不同。当从Linux边缘节点执行"client“
模式
的作业时,该作业工作正常,但来自同一父作业的"cluster”
模式
未运行。下面是
集群
模式
下yarn应用程序日志中的错误:
线程
"
浏览 16
提问于2021-02-25
得票数 0
回答已采纳
1
回答
Local[4]是将整个应用程序限制在4个核心,还是仅仅是火花工作者?
apache-spark
我有一个tensorflow程序,我想在AWS EMR
集群
的主节点上运行,该
集群
仅具有非常轻的火花依赖性--我想执行火花提交命令,以便尽可能多地将资源提供给tensorflow。我在想如果我做了这个火花只会得到4个核心,而myprogram.py会得到其余的--但也许我将整个应用程序的核心数量限制在(假设主节点有32个核) tensorflow程序并不是分布式的--整个流程都是一个很大的火花应用程序,它可以对任务节点执行大量ETL操作,然后培训只在主节
浏览 0
提问于2018-09-11
得票数 0
2
回答
火花急流不加载( CSV不支持文件格式错误,拼板没有错误)
apache-spark
、
nvidia
、
rapids
/home/softy/soft/rapids-4-
spark
/rapids-4-
spark
_2.12-22.06.0-cuda11.jar> --conf
spark
.executor.resource.gpu.amount=1 \ > --conf
spark<
浏览 7
提问于2022-08-08
得票数 0
回答已采纳
1
回答
我可以使用Apache
Spark
单机版分发工作吗?
apache-spark
、
networking
、
cluster-computing
、
apache-spark-standalone
我听到人们谈论"Apache独立
集群
“,这让我感到困惑,因为我将”
集群
“理解为通过潜在的快速网络连接的各种机器并并行工作,而”独立“则是一台孤立的机器或程序。
浏览 14
提问于2017-08-05
得票数 1
回答已采纳
1
回答
混淆使用Yarn资源管理器
python
、
pyspark
、
hadoop-yarn
、
amazon-emr
我正尝试在Amazon AWS中运行一个简单的pyspark作业,它被配置为通过
spark
-default.conf文件使用Yarn。我对Yarn部署代码有点困惑。(conf=conf) 在这种情况下,当指定了'yarn-client‘时,我不确定我应该如何执行
spark
作业。我通常这样做: $
spark
-submit --deploy-mode client
spark
-job.py 但是这两者的区别是什么呢?$
spark
-submit --deploy-mode client
spa
浏览 3
提问于2020-01-27
得票数 1
回答已采纳
4
回答
如果驱动程序崩溃,会发生什么?
apache-spark
我想你会失去所有的工作,因为读取结果的代码不再运行,或者
Spark
不知何故知道如何重新启动它?如果是这样的话,是怎么做的?
浏览 0
提问于2014-10-29
得票数 10
1
回答
从笔记本电脑提交
spark
申请
apache-spark
我想在我的笔记本电脑上提交
spark
python应用程序。我有一个独立的
spark
集群
,而且主服务器运行在某个可见的IP (MASTER_IP)上。在我的笔记本电脑上下载并解压缩
Spark
之后,我得到了这个功能据我所知,它默认是客户端
模式
(vs
集群
<e
浏览 0
提问于2015-10-23
得票数 3
1
回答
sparklyr的
Spark
内存问题
apache-spark
、
jvm
、
sparklyr
我在
Spark
running和sparklyr上有一些奇怪的问题。我目前在一台R生产服务器上,通过
spark
://<my server>:7077以客户端
模式
连接到my
Spark
Cluster,然后从MS SQL server拉取数据。我最近可以做到这一点,没有任何问题,但我最近得到了一个更大的
集群
,现在有内存问题。 首先,我在处理过程中遇到了莫名其妙的“内存不足”错误。这种情况发生了几次,然后我开始得到“内存不足,无法创建新
线程
”的错误。我在R生产
浏览 19
提问于2018-06-01
得票数 0
回答已采纳
1
回答
即使在
Spark
主进程被终止后,
spark
作业仍在运行
apache-spark
、
spark-streaming
、
spark-dataframe
、
hadoop-yarn
我们正在
spark
集群
上工作,即使在
spark
"Master“进程被杀死后,
spark
作业(S)也能成功提交。
spark
-1.6.1-bin-without-hadoop/bin/
spark
-submit --class com.test.test --master yarn-client --部署
模式
客户端现在,当我们杀死"Master“进程时,我们可以看到提交的作业运行良好,这在这
浏览 27
提问于2017-01-30
得票数 1
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
实时音视频
即时通信 IM
活动推荐
运营活动
广告
关闭
领券