其实应该很简单。我有一个pd系列的条形码['Barcode'],我想从中获取过滤器eans(带有12、13或14位数字的条形码)。使用正则表达式,我将在循环中添加到一个新列表。如何同时从原始系列中删除行
bar = pd.read_csv("barcode.csv", header=0, sep=';', engine='python')
ean = []
for i in bar['Barcode']:
x = re.search("\d{12,14}", i)
if(x):
ean.append(x.group())
#bar.drop(bar['Barcode']==x.string, inplace=True)
print(ean)
问题出在我注释掉的那句话上。这不是正确的方法,但我不知道还有什么可能。你能帮我删除这些行吗
提前谢谢
我只是将所有内容累积到一个列表中,然后再删除,在迭代对象时对其进行变异是自找麻烦
首先,将其制作成MWE:
这为我们提供了一个包含两列的简单数据框架,然后我们可以详细地定义一个函数来进行匹配和apply 到该列:
注意:我在字符串的开头使用
r
来关闭转义,并使用^
和$
来匹配字符串的开头和结尾然后,您可以使用它来过滤数据帧:
这让我们回到了比赛的三排
如果您想要一行,而不关心匹配的字符串,可以执行以下操作:
但我认为这样的代码几乎是不可读的
相关问题 更多 >
编程相关推荐