腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
在
PySpark
中
是否有一种使用黑斑羚而不是蜂巢的方法?
pyspark
、
hive
、
impala
、
hue
我正在创建一个简单的
PySpark
文件
,
如
:from
pyspark
.
sql
import SQLContextsconf = SparkConf()sqlContext = HiveContext(sc) sqlContext.
sql
当我
运行
这个脚本时,查询会得到我在Hive
浏览 1
提问于2020-03-25
得票数 0
回答已采纳
1
回答
使用套接字的火花结构化流,设置模式,在控制台中显示DATAFRAME
apache-spark
、
pyspark
、
apache-spark-sql
、
spark-structured-streaming
如
何在
DataFrame
中
为流
PySpark
设置架构。from
pyspark
.
sql
import SparkSessionfrom
pyspark
.
sql
.functionsimport splitfrom
pyspark
.
sql
.types import * spa
浏览 3
提问于2016-12-29
得票数 3
回答已采纳
2
回答
无法导入模块'lambda_function':没有名为'
pyspark
‘的模块
python-3.x
、
pyspark
、
aws-lambda
我正在尝试使用AWS Lambda函数
运行
我的
PySpark
作业代码。下面是错误:无法导入模块'lambda_function':没有名为'
pyspark
‘的模块from
pyspark
.<
浏览 0
提问于2018-12-11
得票数 0
2
回答
将数据保存到HDFS的格式是什么?
hadoop
、
apache-spark
、
hdfs
、
apache-spark-sql
在dataframe或rdd
中
是否有其他格式可用于在Hadoop中保存数据?
浏览 2
提问于2017-12-21
得票数 1
2
回答
在我的Linux终端上
运行
一个脚本来初始化
PySpark
外壳(SparkVersion2.4.4)
linux
、
shell
、
apache-spark
、
terminal
、
pyspark
我在我的Linux计算机上使用
PySpark
。我的火花版本是2.4.4。sqlContext = SQLContext(sc) ( a)在我的终端
中<
浏览 2
提问于2019-10-18
得票数 0
回答已采纳
1
回答
如何使用python在spark中加载
sql
文件
python
、
apache-spark
、
pyspark
我的
pySpark
版本是2.4,python版本是2.7。我有多行
sql
文件
,需要在spark
中
运行
。与逐行
运行
不同的是,是否可以将
sql
文件
保存在python (初始化spark)
中
,并使用submit执行它?我正在尝试用python编写一个通用脚本,以便以后只需要从hdfs
文件
夹
中
替换
sql
文件
。import sys from
pyspark
浏览 8
提问于2022-02-10
得票数 -3
6
回答
如
何在
PySpark
中
运行
脚本
apache-spark
、
pyspark
我正试图在
pyspark
环境
中
运行
一个脚本,但到目前为止,我还没有能够
运行
。 我怎样才能
运行
像python script.py这样的脚本?
浏览 15
提问于2016-10-13
得票数 47
回答已采纳
1
回答
Pyspark
Shell
中
的HiveMetaStore错误,但Jupyter Notebook
中
没有
python
、
hive
、
pyspark
、
pyspark-sql
当我尝试使用
pyspark
dataframe或
sql
时,我遇到了一件奇怪的事情。当它在ipython笔记本或python控制台中工作时,当我在
pyspark
shell
中
运行
它时,我得到了"javax.jdo.JDOFatalInternalException: Error creating简而言之,如果我在iPython笔记本或简单的python终端
中
运行
以下命令,一切都会正常工作: import findspark findspark.init(&quo
浏览 35
提问于2019-05-13
得票数 0
回答已采纳
2
回答
Spark zeppelin:如
何在
%
pyspark
解释器
中
获取%
sql
结果?
apache-spark
、
pyspark
、
apache-spark-sql
、
apache-zeppelin
我知道我可以用 %
pyspark
df = sqlContext.
sql
('select * from train_table') 我可以使用df.registerTempTable('xxx')使df在%
sql
中
可访问。但是有时候我想用%
sql
来画图。移到df = sqlContext.
sql
(
sql
)
中
,重新计算。我想知道有什么方法可以在%
pyspark
中
访问%
sq
浏览 30
提问于2019-02-15
得票数 0
1
回答
从spark调用.hql
文件
scala
、
apache-spark
、
hive
、
pyspark
、
hiveql
我试图像下面这样
运行
hql
文件
,但是得到了错误noviablealtexception你能帮忙吗,怎么
运行
?现在,我将检查的下一个级别是,如果.hqls
中
定义了hiveconf,那么如
何在
sqlContext
中
传递
浏览 1
提问于2018-05-22
得票数 1
1
回答
皮林特用火花放电抛出错误警告
pyspark
、
pylint
但是当我把它应用到我的代码
中
时,我得到了警告:"drop_duplicates是不可调用的“。如果我将代码从"drop_duplicates“更改为"dropDuplicates",则警告将消失。如
何在
不改变整个代码的情况下修复它?我认为drop_duplicates更像蟒蛇风格。我试着添加火花放电存根,但它确实有帮助。
浏览 5
提问于2019-11-18
得票数 2
1
回答
在VS代码
中
调试
PySpark
apache-spark
、
visual-studio-code
、
pyspark
我正在使用VS代码在
PySpark
中
构建一个项目。我安装了
PySpark
,
PySpark
被正确导入并
运行
在木星笔记本上。这样做,我就跑:findspark.init() from
pyspark
.context import SparkContextsc = SparkConte
浏览 2
提问于2022-07-20
得票数 0
2
回答
为什么exp函数在火花放电
中
不起作用?
pyspark
、
apache-spark-sql
、
pyspark-sql
、
exp
我试图从logistic回归的系数中计算赔率比,但我遇到了一个问题,这个问题最好用下面的代码来概括:F.exp(1.2)整数类似地失败。
浏览 3
提问于2020-03-17
得票数 0
回答已采纳
4
回答
Python导入语法:我不认识这个(“它错了.”)
python
、
pyspark
PySpark
的文档在示例
中
包括以下内容:from
pyspark
.
sql
.functions import *from datetime import date, timedelta, datetime 我不认识或理解最后两行的语法。(具体来说:import *from.)请有人向我解释一下,并指出它的
文件</em
浏览 5
提问于2022-06-15
得票数 0
回答已采纳
1
回答
如
何在
PySpark
中
运行
.
sql
文件
sql
、
apache-spark
、
pyspark
、
apache-spark-sql
我能够使用
PySpark
运行
单个
SQL
查询。例如 spark = SparkSession.builder.appNmae("___").getOrCreate() df = spark.
sql
("select * from ...")但是我有一个.
sql
文件
,里面有很多我想要
运行
的查询。我是必须一次一个地执行它们,还是有一种简单的方法来
运行
所有它们?示例: table1
中
的3行3列和table
浏览 37
提问于2020-12-11
得票数 0
回答已采纳
1
回答
Pyspark
:从表
中
读取数据并写入
文件
python
、
apache-spark
、
pyspark
、
azure-hdinsight
我正在使用HDInsight spark集群来
运行
我的
Pyspark
代码。我尝试从postgres表
中
读取数据,并将其写入如下所示的
文件
中
。所以我无法将DataFrame写到
文件
中
。为什么"spark.read“返回DataFrameReader。这里我漏掉了什么?from
pyspark
.
sql
.types import * from
pyspark
.
sql
import SparkSe
浏览 40
提问于2020-04-24
得票数 0
回答已采纳
3
回答
为什么当我使用IPython
运行
Pyspark
时总是得到错误env: ipython:没有这样的
文件
或目录
apache-spark
、
machine-learning
我想用IPython
运行
Pyspark
终端。我已经在正确的目录
中
运行
了该命令,
如
但我最终得到的是env: ipython: No such file or directory 我已经使用brew cask ins
浏览 6
提问于2016-01-28
得票数 2
回答已采纳
2
回答
AssertionError: col应该是列
python
、
apache-spark
、
pyspark
、
apache-spark-sql
如
何在
PySpark
中
创建一个新列并用今天的日期填充该列?
浏览 4
提问于2017-12-20
得票数 30
回答已采纳
1
回答
在Palantir Foundry的代码工作簿
中
如何分配执行者?
palantir-foundry
、
foundry-code-workbooks
如果我在工作簿A
中
运行
一个计算成本很高的
pyspark
转换,并试图在工作簿B
中
运行
某些内容,则这两个队列都将永久排队,直到工作簿A
中
的构建停止,然后工作簿B
中
的生成立即
运行
,就好像它在等待工作簿A
中
的构建
浏览 5
提问于2022-03-24
得票数 0
回答已采纳
1
回答
如何从synapse数据库表
中
读取表
pyspark
、
apache-spark-sql
、
azure-synapse
但我不明白如何使用
Pyspark
来读取这些表。这是我的链接服务数据结构。
浏览 5
提问于2022-08-26
得票数 0
点击加载更多
相关
资讯
0485-如何在代码中指定PySpark的Python运行环境
如何在SQL Server中解密视图
如何在Spark中处理结构化流式数据,如日志文件或传感器数据?
如何在 Ubuntu 中运行 Java 程序?
如何在 Linux 中查找文件
热门
标签
更多标签
云服务器
ICP备案
对象存储
云点播
实时音视频
活动推荐
运营活动
广告
关闭
领券