一个月的周数 pandas

20 投票
8 回答
36570 浏览
提问于 2025-04-18 16:52

我想知道一个月有多少周,有的月份可能有四周,有的可能有五周。对于每个日期,我想知道它属于哪个星期。我最关心的是这个月的最后一周。

data = pd.DataFrame(pd.date_range(' 1/ 1/ 2000', periods = 100, freq ='D'))

0  2000-01-01
1  2000-01-02
2  2000-01-03
3  2000-01-04
4  2000-01-05
5  2000-01-06
6  2000-01-07

8 个回答

0

你可以通过计算当前周和这个月第一天所在周的差值来得到结果,但为了处理年份的第一周和最后一周,还需要一些额外的逻辑。

def get_week(s):
    prev_week = (s - pd.to_timedelta(7, unit='d')).dt.week
    return (
        s.dt.week
        .where((s.dt.month != 1) | (s.dt.week < 50), 0)
        .where((s.dt.month != 12) | (s.dt.week > 1), prev_week + 1)
    )

def get_week_of_month(s):
    first_day_of_month = s - pd.to_timedelta(s.dt.day - 1, unit='d')
    first_week_of_month = get_week(first_day_of_month)
    current_week = get_week(s)
    return  current_week - first_week_of_month
1

这对我来说似乎有效。

df_dates = pd.DataFrame({'date':pd.bdate_range(df['date'].min(),df['date'].max())})
df_dates_tues = df_dates[df_dates['date'].dt.weekday==2].copy()
df_dates_tues['week']=np.mod(df_dates_tues['date'].dt.strftime('%W').astype(int),4)
2

简要概述

import pandas as pd

def weekinmonth(dates):
    """Get week number in a month.
    
    Parameters: 
        dates (pd.Series): Series of dates.
    Returns: 
        pd.Series: Week number in a month.
    """
    firstday_in_month = dates - pd.to_timedelta(dates.dt.day - 1, unit='d')
    return (dates.dt.day-1 + firstday_in_month.dt.weekday) // 7 + 1
    
    
df = pd.DataFrame(pd.date_range(' 1/ 1/ 2000', periods = 100, freq ='D'), columns=['Date'])
weekinmonth(df['Date'])
0     1
1     1
2     2
3     2
4     2
     ..
95    2
96    2
97    2
98    2
99    2
Name: Date, Length: 100, dtype: int64

解释

首先,计算这个月的第一天(可以参考这个答案:如何将日期调整到这个月的第一天?):

df = pd.DataFrame(pd.date_range(' 1/ 1/ 2000', periods = 100, freq ='D'), columns=['Date'])
df['MonthFirstDay'] = df['Date'] - pd.to_timedelta(df['Date'].dt.day - 1, unit='d')
df
         Date MonthFirstDay
0  2000-01-01    2000-01-01
1  2000-01-02    2000-01-01
2  2000-01-03    2000-01-01
3  2000-01-04    2000-01-01
4  2000-01-05    2000-01-01
..        ...           ...
95 2000-04-05    2000-04-01
96 2000-04-06    2000-04-01
97 2000-04-07    2000-04-01
98 2000-04-08    2000-04-01
99 2000-04-09    2000-04-01

[100 rows x 2 columns]

从第一天获取星期几:

df['FirstWeekday'] = df['MonthFirstDay'].dt.weekday
df
         Date MonthFirstDay  FirstWeekday
0  2000-01-01    2000-01-01             5
1  2000-01-02    2000-01-01             5
2  2000-01-03    2000-01-01             5
3  2000-01-04    2000-01-01             5
4  2000-01-05    2000-01-01             5
..        ...           ...           ...
95 2000-04-05    2000-04-01             5
96 2000-04-06    2000-04-01             5
97 2000-04-07    2000-04-01             5
98 2000-04-08    2000-04-01             5
99 2000-04-09    2000-04-01             5

[100 rows x 3 columns]

现在我可以通过对星期几进行取模运算来计算这个月的周数:

  1. 通过 df['Date'].dt.day 获取这个月的日期,并确保在进行取模计算时从0开始 df['Date'].dt.day-1
  2. 加上星期几的数字,以确定这个月的哪一天开始 + df['FirstWeekday']
  3. 安全起见,使用7天为一周的整数除法,并加1,使得这个月的周数从1开始 // 7 + 1

完整的取模计算:

df['WeekInMonth'] = (df['Date'].dt.day-1 + df['FirstWeekday']) // 7 + 1
df
         Date MonthFirstDay  FirstWeekday  WeekInMonth
0  2000-01-01    2000-01-01             5            1
1  2000-01-02    2000-01-01             5            1
2  2000-01-03    2000-01-01             5            2
3  2000-01-04    2000-01-01             5            2
4  2000-01-05    2000-01-01             5            2
..        ...           ...           ...          ...
95 2000-04-05    2000-04-01             5            2
96 2000-04-06    2000-04-01             5            2
97 2000-04-07    2000-04-01             5            2
98 2000-04-08    2000-04-01             5            2
99 2000-04-09    2000-04-01             5            2

[100 rows x 4 columns]
4

我在处理有日期时间索引的数据框时,使用了下面的代码。

import pandas as pd
import math

def add_week_of_month(df):
    df['week_in_month'] = pd.to_numeric(df.index.day/7)
    df['week_in_month'] = df['week_in_month'].apply(lambda x: math.ceil(x))
    return df

如果你运行这个例子:

df = test = pd.DataFrame({'count':['a','b','c','d','e']},
                     index = ['2018-01-01', '2018-01-08','2018-01-31','2018-02-01','2018-02-28'])
df.index = pd.to_datetime(df.index)

你应该会得到以下的数据框

               count  week_in_month

2018-01-01     a              1
2018-01-08     b              2
2018-01-31     c              5
2018-02-01     d              1
2018-02-28     e              4
18

看看这个 回答,然后决定你想要哪个月份的周数。

没有现成的功能,所以你需要用 apply 来计算。比如说,想要简单地计算“已经过去了多少个7天的周期”。

data['wom'] = data[0].apply(lambda d: (d.day-1) // 7 + 1)

如果想要更复杂的计算(基于日历),可以使用那个回答中的函数。

import datetime
import calendar

def week_of_month(tgtdate):
    tgtdate = tgtdate.to_datetime()

    days_this_month = calendar.mdays[tgtdate.month]
    for i in range(1, days_this_month):
        d = datetime.datetime(tgtdate.year, tgtdate.month, i)
        if d.day - d.weekday() > 0:
            startdate = d
            break
    # now we canuse the modulo 7 appraoch
    return (tgtdate - startdate).days //7 + 1

data['calendar_wom'] = data[0].apply(week_of_month)

撰写回答