腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
IPython
:
查询
处理
时间
的
groupby
列
pandas
、
ipython
143613945 143614466xyz 164859531 164900406COL1 COL4xyz 42026
浏览 0
提问于2017-01-28
得票数 1
回答已采纳
1
回答
在Spark SQL中使用
groupby
的
最佳实践是什么?
apache-spark
、
apache-spark-sql
我有一个按多
列
分组
的
Spark SQL。我想知道
列
的
顺序是否对
查询
性能有影响。 在较早
的
时间
放置具有更多不同值
的
列
是否有帮助?我假设
groupby
基于某种散
列
/混洗算法。如果第一个
groupby
可以将数据分发到可以保存在一台机器上
的
较小子集,则后面的
groupby
可以在本地完成。这是真的吗?
groupby
的<
浏览 8
提问于2019-03-10
得票数 0
1
回答
熊猫--计算买卖双方
的
互动关系
python-2.7
、
pandas
我有几年
的
日常数据(位于潘达斯DataFrame)
的
买家和卖家ala。我想计算,在一个月
的
基础上,每个购买银行,他们
的
份额,每月总成交量来自每个卖家,他们已经互动。Bank5 Bank3 5/27 任何输入都是非常感谢
的
!
浏览 6
提问于2014-04-15
得票数 0
回答已采纳
1
回答
截断ObjectQuery中
的
时间
部分
c#
、
sql-server
、
entity-framework
我正在创建一个对象
查询
,在
查询
中有一个
groupBy
子句,如下所示:但我得到了一个例外:附加信息:找不到类型'date‘。确保加载了所需
的
架构,并且正确导入了命名空间。类型名称附近,第7行,第73
列
浏览 1
提问于2015-05-19
得票数 0
1
回答
熊猫群独特
的
多栏
python
、
python-3.x
、
pandas
、
group-by
16 700 800 28 700 1000 2df.
groupby
(['number'])['id1'].unique() 0 [100] 1 [300,[100
浏览 1
提问于2017-11-22
得票数 7
回答已采纳
3
回答
Numpy操作在
groupby
中无效。改用.
groupby
(...).mean(),我就是这么做
的
python
、
pandas
、
dataframe
、
group-by
、
mean
我想根据数据段Segment得到以下数据帧people_preferences
的
前两
列
中每
列
的
平均值。Use .
groupby
(...).mean() instead--------------------------------------------------------------------------- UnsupportedFunctionCall Traceback (most recent call last
浏览 0
提问于2019-11-29
得票数 3
1
回答
我怎样才能加快熊猫群
的
速度,因为它在不止一个专栏上表现了一笔钱?
python
、
pandas
、
numpy
、
pandas-groupby
如果我
的
理解是正确的话,减速是由于
处理
的
结果组
的
数量。是否有可能将该方法矢量化,并立即将求和应用于每个组,而不是假设当前正在迭代
的
是什么。Notes 我尝试过使用
groupby
().agg({...})和
groupby
().apply(lambda),两者花费
的
时间
差不多一样。我也尝试过移除一些
groupby
列
,然后稍后再添加它们,但是它并没有加快计算速度,所以没有理由将它们从
groupby
浏览 0
提问于2021-11-07
得票数 1
回答已采纳
1
回答
Dask -将Timestamp
列
转换为date并设置为index终止进程
dask
、
dask-dataframe
我是新来达斯克
的
我有152个拼花面板文件,平均200MB。(机器内存32 on ) 每个文件都有
时间
戳
列
,我想将该
列
设置为分区(索引)。如果我将Timestamp
列
设置为index,则分区太多,因此需要将其转换为Date --> ddf = dd.read_parquet('gs://bucket_name/*.parquet') ddf['partition'] = dd.to_datetime(ddf['event
浏览 7
提问于2021-04-28
得票数 1
3
回答
如何检查numpy/pandas对象,即R中
的
str()
python
、
r
、
numpy
、
pandas
我最近改用Python进行统计,不知道如何检查我遇到
的
对象。例如:heart = sm.datasets.heart.load_pandas().data我想调查一下允许我在末尾添加['age']
的
heart.
groupby
(['censors'])是什么类型
的
对象。然而,print heart.<
浏览 1
提问于2015-01-27
得票数 1
1
回答
聚合后如何比较它们之间
的
列
(Python、pandas)?
python
、
pandas
、
aggregation
Python中
的
新手,尝试在聚合后比较
列
(df.median == df.mean)之间
的
结果,但没有用。df.
groupby
('Club')['Wage'].agg(['median', 'mean']).reset_index() KeyErrorTraceback (most recent call last) <
ipython
-input-184-5b0cdf62f540> in
浏览 0
提问于2020-07-03
得票数 1
2
回答
当我们用自定义函数对
groupby
的
结果使用apply时,不会传递所有
列
。
python
、
pandas
、
apply
、
pandas-groupby
c‘
的
每个值使用一个函数。所以我对apply()
的
结果使用了
groupby
函数。\
groupby
.py", line 2273, in apply AttributeError: 'DataFrame' object has no attribute
浏览 0
提问于2018-12-10
得票数 2
回答已采纳
2
回答
大熊猫群游:快速之道
python
、
pandas
、
numpy
、
pandas-groupby
我想改善大熊猫
的
groupby
时间
。我有这样
的
代码:目标是计算一个客户在一个月内有多少合同,并将这些信息添加到一个新
列
(Nbcontrats)中。Client:客户端代码 我想改善
时间
浏览 5
提问于2016-07-01
得票数 23
回答已采纳
1
回答
Python绘图
groupby
.mean
python
、
pandas
、
dataframe
、
group-by
、
mean
Ferrand 4 536453 2015-11-27 18:09:00 On 4 18 1 ----&g
浏览 1
提问于2017-03-05
得票数 2
1
回答
计算Pandas中组中
列
的
更改百分比
python
、
pandas
、
pandas-groupby
我
的
dataframe有一个Ticker
列
和一个Price
列
。每个Ticker有10行(具有相同
的
Ticker值),但每行具有不同
的
Price。Test_preds_actual1['Target1_preds_pct_chng'] = 0 Test_preds_actual1.
groupby
('Ticker')['Target
浏览 9
提问于2020-02-14
得票数 1
回答已采纳
1
回答
在Python中运行泰尔-森回归时出错
python
、
python-3.x
、
pandas
、
scipy
、
linear-regression
这两种数据都具有相同
的
数据类型。因此,除了实际使用
的
技术之外,计算它们
的
函数应该是相同
的
。然而,我得到了以下错误,这是我一直以来最难理解如何解决
的
错误: 实际
的
可变
时间
是一个numpy浮点对象,所以它不是字符串。这使我相信,stats.theilslopes函数并没有认识到
时间
是dataframe中
的
一个
列
,而是使用' tim
浏览 0
提问于2019-06-07
得票数 1
回答已采纳
1
回答
MySql select -
groupBy
很生气?
mysql
、
database
、
select
、
optimization
、
group-by
hotelId是来自另一个系统
的
标识,它
的
目的仅是为了“获取酒店
的
细节”和
groupBy
(保证唯一
的
酒店获得结果)。我
的
选择平均有10-15
列
。我认为问题是因为选择‘触摸’~70%
的
行,然后是
groupBy
,它将返回200-400个
浏览 0
提问于2017-06-06
得票数 1
1
回答
熊猫Dataframe聚合对象类型
python
、
python-3.x
、
pandas
、
group-by
、
aggregate
我想按'name‘
列
groupped = df.
groupby
(["name"]) 对数据进行分组,但我也有“对象类型”,目标是只保留一个对象类型(例如:第一个对象类型)。他们是一样
的
。因此,我尝试使用min,但它不起作用,但我找不到任何其他函数来
处理
对象类型。---------------------- TypeError
浏览 1
提问于2021-05-06
得票数 0
回答已采纳
1
回答
熊猫:加速群居?
python
、
pandas
、
group-by
我想知道是否有可能通过以下应用程序加快熊猫dataframe.
groupby
的
速度: 其余5
列
(colA假设条目发生了更改,我不会删除它,而是在“上次修改”
列
中写入带有新值
的
新行。这使我能够追溯了解条目是如何随
时间
变化
的
。方法占用了我大约70%
的
运行
时间
。不需要
浏览 6
提问于2014-12-12
得票数 1
1
回答
筛选两个带有LIKE 'prefix%‘
的
nvarchar
列
时SQL改善计数(*)
sql
、
sql-server
、
performance
、
entity-framework
我正在尝试提高一个简单
查询
的
性能,该
查询
返回nvarchar(64)
列
FromNumber或
列
ToNumber以给定前缀(在本例中为‘1002’)开头
的
行数。这是当前
的
SQL
查询
(由Entity Framework生成): [
GroupBy
1].[ToNumber] LIKE @p__linq__1 ESCAPE N''~'
浏览 2
提问于2015-10-05
得票数 0
1
回答
更改pyspark show()中变量
的
格式
python
、
pyspark
、
group-by
、
apache-spark-sql
、
format
我需要在pyspark中格式化group by
的
计数值 df.
groupBy
('PURCHASE').count().show() |PURCHASE| count|| 202003|1426702|| 202001|94333 | 我想用逗号作为千分隔符显示count
列
|PURCHASE| count || 202003|1,426,702|| 202001
浏览 29
提问于2020-10-08
得票数 1
回答已采纳
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
实时音视频
云点播
活动推荐
运营活动
广告
关闭
领券