Python滚动平均计算中如何忽略NaN

2024-04-23 09:31:06 发布

您现在位置:Python中文网/ 问答频道 /正文

对于时间序列销售预测任务,我想创建一个表示过去3天平均销售额的功能。当我想预测未来几天的销售额时,我遇到了一个问题,因为这些数据点没有销售数据(NaN值)。Pandas提供rolling_mean(),但当窗口中的任何数据点为NaN时,该函数将产生一个NaN输出。在

我的数据:

Date    Sales
02-01-2013  100.0
03-01-2013  200.0
04-01-2013  300.0
05-01-2013  200.0
06-01-2013  NaN

使用后的结果pd.滚动平均值()窗口为2:

^{pr2}$

期望结果:

Date    Rolling_Sales
02-01-2013  NaN
03-01-2013  150.0
04-01-2013  250.0
05-01-2013  250.0
06-01-2013  200.0

因此,如果包含了anan,我想忽略它,并取窗口中所有其他数据点的平均值。在


Tags: 数据函数功能pandasdate时间序列nan
1条回答
网友
1楼 · 发布于 2024-04-23 09:31:06

这里正在添加min_periods

s=df.Sales.rolling(window=2,min_periods=1).mean()
s.iloc[0]=np.nan
s
Out[1293]: 
0      NaN
1    150.0
2    250.0
3    250.0
4    200.0
Name: Sales, dtype: float64

相关问题 更多 >