将PIL黑白图像转换为Numpy数组时出错
我在尝试把一个黑白的PIL图像转换成numpy数组时,遇到了奇怪的错误。下面是我正在使用的代码示例。
if image.mode != '1':
image = image.convert('1') #convert to B&W
data = np.array(image) #Have also tried np.asarray(image)
n_lines = data.shape[0] #number of raster passes
line_range = range(data.shape[1])
for l in range(n_lines):
# process one horizontal line of the image
line = data[l]
for n in line_range:
if line[n] == 1:
write_line_to(xl, z+scale*n, speed) #conversion to other program code
elif line[n] == 0:
run_to(xl, z+scale*n) #conversion to other program code
我试过用array和asarray这两种方法来转换,但遇到的错误不一样。如果我用array,得到的数据和我输入的完全不一样。看起来像是几张非常缩小的部分图像并排在一起,剩下的地方全是黑色。如果我用asarray,整个python在处理某一行时就崩溃了,崩溃的行是随机的。如果我处理的是灰度图像('L'),那么用array或asarray都不会出现这些错误。
有没有人知道我哪里出错了?PIL在编码黑白图像时有什么特别的地方吗?或者我需要给numpy传递什么特别的参数才能正确转换?
3 个回答
你用的numpy版本是什么?我发现把numpy从1.21降级到1.20之后,它就能正常工作了。
pip install numpy==1.20
我对这一行不太确定:
data = numpy.array(image)
实际上,这会让我程序崩溃(segfault)。但是我刚刚尝试了下面的代码,它运行得很好:
import numpy
import Image
im = Image.open("some_photo.jpg")
im = im.convert("1")
pixels = im.getdata() # returns 1D list of pixels
n = len(pixels)
data = numpy.reshape(pixels, im.size) # turn into 2D numpy array
for row in data:
# do your processing
pass
# Check that the numpy array's data is good
im2 = Image.new("1", im.size)
im2.putdata(numpy.reshape(data, [n, 1]))
im2.show()
我觉得你发现了PIL中的一个bug!(或者可能是numpy的问题,但我觉得更可能是PIL这边的问题…)
@c的回答提供了一个解决办法(使用im.getdata()),不过我不太明白为什么numpy.asarry(image)会让他出现段错误…(可能是PIL和/或numpy的旧版本?)对我来说是可以用的,但在处理1位的PIL图像时会出现乱码(不过对其他图像都能正常工作,我经常用!)。
另一个解决办法是先把黑白图像转换回灰度图(模式'L'),再转换成numpy数组。
如果速度很重要,先把黑白图像转换回灰度图再转成numpy数组似乎会更快。
In [35]: %timeit np.array(im_bw.convert('L')).astype(np.uint8)
10000 loops, best of 3: 28 us per loop
In [36]: %timeit np.reshape(im_bw.getdata(), im_bw.size)
10000 loops, best of 3: 57.3 us per loop
另外,如果你在直接修改数组的内容,记得用numpy.array而不是numpy.asarray,因为后者会从PIL图像实例创建一个数组而不复制内存,这样返回的数组是只读的。我提到这个是因为我下面会用到asarray()…
这里有一个独立的例子来确认这个bug…
import numpy as np
import Image
x = np.arange(256, dtype=np.uint8).reshape((16,16))
print 'Created array'
print x
im = Image.fromarray(x)
print 'Vales in grayscale PIL image using numpy.asarray <-- Works as expected'
print np.asarray(im)
print 'Converted to BW PIL image...'
im_bw = im.convert('1')
print 'Values in BW PIL image, using Image.getdata() <-- Works as expected'
print ' (Not a simple threshold due to dithering...)'
# Dividing by 255 to make the comparison easier
print np.reshape(im_bw.getdata(), (16, 16)) / 255
print 'Values in BW PIL image using numpy.asarray() <-- Unexpected!'
print ' (Same occurs when using numpy.array() to copy and convert.)'
print np.asarray(im_bw).astype(np.uint8)
print 'Workaround, convert back to type "L" before array conversion'
print np.array(im_bw.convert('L')).astype(np.uint8) / 255
输出结果是:
Created array
[[ 0 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15]
[ 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31]
[ 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47]
[ 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63]
[ 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79]
[ 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95]
[ 96 97 98 99 100 101 102 103 104 105 106 107 108 109 110 111]
[112 113 114 115 116 117 118 119 120 121 122 123 124 125 126 127]
[128 129 130 131 132 133 134 135 136 137 138 139 140 141 142 143]
[144 145 146 147 148 149 150 151 152 153 154 155 156 157 158 159]
[160 161 162 163 164 165 166 167 168 169 170 171 172 173 174 175]
[176 177 178 179 180 181 182 183 184 185 186 187 188 189 190 191]
[192 193 194 195 196 197 198 199 200 201 202 203 204 205 206 207]
[208 209 210 211 212 213 214 215 216 217 218 219 220 221 222 223]
[224 225 226 227 228 229 230 231 232 233 234 235 236 237 238 239]
[240 241 242 243 244 245 246 247 248 249 250 251 252 253 254 255]]
Vales in grayscale PIL image using numpy.asarray <-- Works as expected
[[ 0 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15]
[ 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31]
[ 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47]
[ 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63]
[ 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79]
[ 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95]
[ 96 97 98 99 100 101 102 103 104 105 106 107 108 109 110 111]
[112 113 114 115 116 117 118 119 120 121 122 123 124 125 126 127]
[128 129 130 131 132 133 134 135 136 137 138 139 140 141 142 143]
[144 145 146 147 148 149 150 151 152 153 154 155 156 157 158 159]
[160 161 162 163 164 165 166 167 168 169 170 171 172 173 174 175]
[176 177 178 179 180 181 182 183 184 185 186 187 188 189 190 191]
[192 193 194 195 196 197 198 199 200 201 202 203 204 205 206 207]
[208 209 210 211 212 213 214 215 216 217 218 219 220 221 222 223]
[224 225 226 227 228 229 230 231 232 233 234 235 236 237 238 239]
[240 241 242 243 244 245 246 247 248 249 250 251 252 253 254 255]]
Converted to BW PIL image...
Values in BW PIL image, using Image.getdata() <-- Works as expected
(Not a simple threshold due to dithering...)
[[0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0]
[0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0]
[0 0 0 0 0 0 0 0 0 0 1 0 0 0 1 0]
[0 0 1 0 1 0 1 0 1 0 0 0 1 0 0 0]
[0 1 0 0 0 0 0 0 0 0 1 0 0 1 0 1]
[0 0 0 1 0 1 0 1 0 1 0 1 0 0 0 0]
[1 0 1 0 1 0 1 0 1 0 0 0 1 1 0 1]
[0 1 0 1 0 0 1 0 0 1 1 0 1 0 1 0]
[1 0 1 0 1 0 1 1 0 1 0 1 0 1 0 1]
[0 1 0 1 0 1 0 1 0 1 1 0 1 1 0 1]
[1 1 0 1 1 1 1 0 1 1 0 1 1 0 1 1]
[1 0 1 1 0 1 0 1 1 0 1 1 0 1 1 0]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]
[1 0 1 0 1 1 0 1 1 0 1 1 1 0 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]]
Values in BW PIL image using numpy.asarray() <-- Unexpected!
(Same occurs when using numpy.array() to copy and convert.)
[[0 0 0 0 0 1 1 1 1 1 1 1 1 1 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]
[0 1 1 1 1 1 1 0 0 0 0 0 1 1 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]]
Workaround, convert back to type "L" before array conversion
[[0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0]
[0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0]
[0 0 0 0 0 0 0 0 0 0 1 0 0 0 1 0]
[0 0 1 0 1 0 1 0 1 0 0 0 1 0 0 0]
[0 1 0 0 0 0 0 0 0 0 1 0 0 1 0 1]
[0 0 0 1 0 1 0 1 0 1 0 1 0 0 0 0]
[1 0 1 0 1 0 1 0 1 0 0 0 1 1 0 1]
[0 1 0 1 0 0 1 0 0 1 1 0 1 0 1 0]
[1 0 1 0 1 0 1 1 0 1 0 1 0 1 0 1]
[0 1 0 1 0 1 0 1 0 1 1 0 1 1 0 1]
[1 1 0 1 1 1 1 0 1 1 0 1 1 0 1 1]
[1 0 1 1 0 1 0 1 1 0 1 1 0 1 1 0]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]
[1 0 1 0 1 1 0 1 1 0 1 1 1 0 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]
[1 1 1 1 1 1 1 1 1 1 1 1 1 1 1 1]]