如何根据列中的条件进行计算？

Compresor = pd.Series([0,0,1,1,1,0,0,1,1,1,0,0,0,0,1,1,1,0], index = pd.date_range('1/1/2012', periods=18, freq='5 min')) df = pd.DataFrame(Compresor) df.index.rename("Date", inplace=True) df.set_axis(["ON_OFF"], axis=1, inplace=True) df.loc[(df.ON_OFF == 1), 'Electricity'] = np.random.randint(4, 20, df.sum()) df.loc[(df.ON_OFF < 1), 'Electricity'] = 0 df ON_OFF Electricity Date 2012-01-01 00:00:00 0 0.0 2012-01-01 00:05:00 0 0.0 2012-01-01 00:10:00 1 4.0 2012-01-01 00:15:00 1 10.0 2012-01-01 00:20:00 1 9.0 2012-01-01 00:25:00 0 0.0 2012-01-01 00:30:00 0 0.0 2012-01-01 00:35:00 1 17.0 2012-01-01 00:40:00 1 10.0 2012-01-01 00:45:00 1 5.0 2012-01-01 00:50:00 0 0.0 2012-01-01 00:55:00 0 0.0 2012-01-01 01:00:00 0 0.0 2012-01-01 01:05:00 0 0.0 2012-01-01 01:10:00 1 14.0 2012-01-01 01:15:00 1 5.0 2012-01-01 01:20:00 1 19.0 2012-01-01 01:25:00 0 0.0

2条回答

网友

1楼 · 编辑于 2024-06-02 05:51:45

我要做的是创建一个变量，用一个整数作为ID来表示每个活动周期，然后按它分组并对Electricity列求和。创建它的一种简单方法是通过累计求和On_Off（数据必须按递增日期排序）并将结果值乘以On_Off列。如果你提供一个可复制的例子，你的表在熊猫我可以很快写你的解决方案。你知道吗

希望有帮助

网友

2楼 · 编辑于 2024-06-02 05:51:45

假设您有以下数据：

from operator import itemgetter

import numpy as np
import numpy.random as rnd
import pandas as pd
from funcy import concat, repeat
from toolz import partitionby

base_data = {
    'time': list(range(20)),
    'state': list(concat(repeat(0, 3), repeat(1, 4), repeat(0, 5), repeat(1, 6), repeat(0, 2))),
    'value': list(concat(repeat(0, 3), rnd.randint(5, 20, 4), repeat(0, 5), rnd.randint(5, 20, 6), repeat(0, 2)))
}

有两种方法：

第一种方法是函数式的，与pandas无关：您只需按字段partition处理数据，即该方法按顺序处理数据，并在每次字段值更改时生成一个新分区。然后可以根据需要简单地汇总每个分区。你知道吗

# transform into sample data
sample_data = [dict(zip(base_data.keys(), x)) for x in zip(*base_data.values())]
# and compute statistics the functional way
[sum(x['value'] for x in part if x['state'] == 1)
 for part in partitionby(itemgetter('state'), sample_data)
 if part[0]['state'] == 1]

还有pandas方法，类似于@ivalesp提到的：通过移动state列来计算状态的变化。然后你summarize your data frame by the group


pd_data = pd.DataFrame(base_data)
pd_data['shifted_state'] = pd_data['state'].shift(fill_value = pd_data['state'][0])
pd_data['cum_state'] = np.cumsum(pd_data['state'] != pd_data['shifted_state'])
pd_data[pd_data['state'] == 1].groupby('cum_state').sum()

根据你和你的同龄人最擅长阅读的内容，你可以选择自己的方式。此外，功能方式可能不容易可读，并且也可以用可读的循环语句重写。你知道吗

相关问题更多 >

编程相关推荐

热门问题

热门文章