番外6. 在 Python OpenCV 针对图像细节的不同操作

本系列专栏写作方式

本系列专栏写作将采用首创的问答式写作形式,快速让你学习到 OpenCV 的初级、中级、高级知识。

6. 在 Python OpenCV 针对图像细节的不同操作

本篇博客的目标将为你解释一幅图像的拆解,包括图像像素的说明,图像属性信息的获取与修改,
图像目标区域 ROI 相关内容,以及图像通道的知识(包括拆分通道和合并通道)

这些内容在知识结构上与 numpy 库十分紧密,如果从学习的角度出发,建议你储备一下 numpy 相关知识。

读取修改图像的像素值

在之前的博客中,我们已经学到了如何读取一幅图像,使用 cv2.imread 函数即可,并且掌握了该函数的两个关键参数。

读取图片之后,我们可以直接使用操作数组的方式获取图像任意位置的颜色,一般这个颜色的默认顺序是 BGR。

测试代码如下:

import cv2
import matplotlib.pyplot as plt

src = cv2.imread("./6_test.jpg")

# 获取 100 x 100 位置的像素值
print(src[100, 100])

cv2.imshow("src", src)

cv2.waitKey()

这里首先获取 100 x 100 位置的像素值。
src[100,100]会获取到三个值,分别对应的 BGR 通道的值。我们在图片上标记一个像素点,rows = 250,cols=470 ,接下来修改上述代码,看获取到的 BGR 值。

import cv2
import matplotlib.pyplot as plt

src = cv2.imread("./6_test.jpg")

# 注意获取像素值的格式为 [cols,rows]
print(src[250, 470])

cv2.imshow("src", src)

cv2.waitKey()
587f81e76b304cfcbd80805893f3ddfc[1].png

上文特别注意的就是,获取像素值的格式为 [cols,rows],列在前,行在后。

以上获取到的是 BGR 值,也可以只获取单个通道的值,对应的代码是 [cols,rows,channel],对应到代码部分,如下所示:

# 获取蓝色通道值
print(src[250, 470, 0])

蓝色通道对应 0,绿色通道为 1,红色通道为 2,超出以上三个值,就会出现如下错误:

IndexError: index 3 is out of bounds for axis 2 with size 3

当前如果你直接读取了灰度图,例如下述代码,三个通道的值是相同的。

import cv2
import matplotlib.pyplot as plt

src = cv2.imread("./6_test.jpg", 0)

# 注意获取像素值的格式为 [cols,rows]
print(src[250, 470])

cv2.imshow("src", src)

cv2.waitKey()

这个地方还有一个编码上存在的潜在问题,如果读取的是四通道图片,即图片有透明度,那数组的索引值可以读取到 3,也就是下述代码是正确的。

import cv2
import matplotlib.pyplot as plt

src = cv2.imread("./test.png", -1)

# 注意获取像素值的格式为 [cols,rows]
print(src[250, 470, 3])

cv2.imshow("src", src)

cv2.waitKey()

src[250, 470, 3] 成功读取到了透明通道的值。

我们可以针对特定的像素点进行值的修改,例如下述代码

import cv2
import matplotlib.pyplot as plt

src = cv2.imread("./6_test.jpg")

# 注意获取像素值的格式为 [cols,rows]
src[250, 470] = [255, 255, 255]

cv2.imshow("src", src)

cv2.waitKey()

注意下图的红色箭头指向的位置,出现一个白色亮点,使用该办法,可以制造出一个【椒盐图片】。

ca1e2f6be06e42a38e9fe291f78e18a3[1].png

这个地方需要注意的一个潜在 BUG,读取图片的通道数,决定了你复制时数组元素个数,例如下述代码将会报错。

import cv2
import matplotlib.pyplot as plt

src = cv2.imread("./6_test.jpg")

# 注意获取像素值的格式为 [cols,rows]
src[250, 470] = [255, 255, 255, 255]

cv2.imshow("src", src)

cv2.waitKey()

错误信息都是类似的,提示数组维度不同。

ValueError: cannot copy sequence with size 4 to array axis with dimension 3

最后一点使用以上方式操作图像的像素点,非常耗时,因为一张图片的像素点数据是非常大的,一般情况下能用 numpy 集成好的方法,就不要用这种最笨拙的方式。

使用 numpy 获取通道值,注意该方式获取的是标量,如果你想获得所有 BGR 的值,你需要使用 array.item() 依次获取。

import cv2
import numpy as np

src = cv2.imread("./6_test.jpg")
print(src[100, 100])
b = src.item(100, 100, 0)
g = src.item(100, 100, 1)
r = src.item(100, 100, 2)
print(b, g, r)

cv2.imshow("src", src)
cv2.waitKey()

如果希望设置该值,直接使用 itemset 函数即可。

src.itemset((100, 100, 0), 200)
print(src[100, 100])

可以任意寻找一张图片进行对应的测试,运行效果如下:

[ 31  68 118]
31 68 118
[200  68 118]

OpenCV 中图像属性常见问题解析

对于一幅图像,除了像素矩阵以外,还有一个非常重要的内容,是图像的属性,这些包括行、列、通道、数据类型,像素数量、图像形状等内容。

例如,我们经常使用 img.shape 去获取图像的形状,尤其注意的是,返回的内容是行数(rows),列数(cols),以及通道数(channels),并且返回值类型是一个元组。

如果你读取图像的时候,设置紧读取灰度图,那只会返回行数和列数,相应的通过这个值很容易能判断出你加载的图像类型。

例如下述代码,通过不同的方式读取同一张图片,输出图像的不同形状。

import cv2
import numpy as np

# 选择一个 png 图片,可以读取到不同的通道
src1 = cv2.imread("./test.png", -1)
src2 = cv2.imread("./test.png", 0)
src3 = cv2.imread("./test.png")
# 四通道,包含透明通道
print(src1.shape)
# 灰度图
print(src2.shape)
# 三通道
print(src3.shape)

输出结果可以快速的读取出图像是彩色图像还是灰度图像。

(397, 595, 4)
(397, 595)
(397, 595, 3)

使用 img.size 可以快速返回图像中像素的合计数目,测试代码如下:

# 选择一个 png 图片,可以读取到不同的通道
src1 = cv2.imread("./test.png", -1)
src2 = cv2.imread("./test.png", 0)
src3 = cv2.imread("./test.png")
# 四通道,包含透明通道
print(src1.shape)
print(src1.size)
# 灰度图
print(src2.shape)
print(src2.size)
# 三通道
print(src3.shape)
print(src3.size)

我们依旧三种不同的读取方式,读取到的像素数分别如下:

(397, 595, 4)
944860
(397, 595)
236215
(397, 595, 3)
708645

注意,灰度图像和彩色图像的像素数不同,它们之前存在如下关系。

灰度图像的像素数 = 行数 x 列数 = 397 x 595 = 236215

彩色图像的像素数 = 行数 x 列数 x 通道数 = 944860 (四通道)/ 708645(三通道)

使用 img.dtype 属性可以获取到图像的类型,具体如下:

print(src1.dtype)

这里读取到的值,都是相同的 uint8 表示 8 位图像,这里可以记住只要是 uint8 格式,那对应的 BGR 值的范围就是在 [0,255] 之间。

在操作上述属性值的时候,会出现如下 BUG,该 BUG 的通用解决方案是排查图片是否正常读取,需要特别注意下:

AttributeError: 'NoneType' object has no attribute 'shape'
print(src1.dtype)

这里读取到的值,都是相同的 uint8 表示 8 位图像,这里可以记住只要是 uint8 格式,那对应的 BGR 值的范围就是在 [0,255] 之间。

在操作上述属性值的时候,会出现如下 BUG,该 BUG 的通用解决方案是排查图片是否正常读取,需要特别注意下:

AttributeError: 'NoneType' object has no attribute 'shape'
©著作权归作者所有,转载或内容合作请联系作者
  • 序言:七十年代末,一起剥皮案震惊了整个滨河市,随后出现的几起案子,更是在滨河造成了极大的恐慌,老刑警刘岩,带你破解...
    沈念sama阅读 219,110评论 6 508
  • 序言:滨河连续发生了三起死亡事件,死亡现场离奇诡异,居然都是意外死亡,警方通过查阅死者的电脑和手机,发现死者居然都...
    沈念sama阅读 93,443评论 3 395
  • 文/潘晓璐 我一进店门,熙熙楼的掌柜王于贵愁眉苦脸地迎上来,“玉大人,你说我怎么就摊上这事。” “怎么了?”我有些...
    开封第一讲书人阅读 165,474评论 0 356
  • 文/不坏的土叔 我叫张陵,是天一观的道长。 经常有香客问我,道长,这世上最难降的妖魔是什么? 我笑而不...
    开封第一讲书人阅读 58,881评论 1 295
  • 正文 为了忘掉前任,我火速办了婚礼,结果婚礼上,老公的妹妹穿的比我还像新娘。我一直安慰自己,他们只是感情好,可当我...
    茶点故事阅读 67,902评论 6 392
  • 文/花漫 我一把揭开白布。 她就那样静静地躺着,像睡着了一般。 火红的嫁衣衬着肌肤如雪。 梳的纹丝不乱的头发上,一...
    开封第一讲书人阅读 51,698评论 1 305
  • 那天,我揣着相机与录音,去河边找鬼。 笑死,一个胖子当着我的面吹牛,可吹牛的内容都是我干的。 我是一名探鬼主播,决...
    沈念sama阅读 40,418评论 3 419
  • 文/苍兰香墨 我猛地睁开眼,长吁一口气:“原来是场噩梦啊……” “哼!你这毒妇竟也来了?” 一声冷哼从身侧响起,我...
    开封第一讲书人阅读 39,332评论 0 276
  • 序言:老挝万荣一对情侣失踪,失踪者是张志新(化名)和其女友刘颖,没想到半个月后,有当地人在树林里发现了一具尸体,经...
    沈念sama阅读 45,796评论 1 316
  • 正文 独居荒郊野岭守林人离奇死亡,尸身上长有42处带血的脓包…… 初始之章·张勋 以下内容为张勋视角 年9月15日...
    茶点故事阅读 37,968评论 3 337
  • 正文 我和宋清朗相恋三年,在试婚纱的时候发现自己被绿了。 大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
    茶点故事阅读 40,110评论 1 351
  • 序言:一个原本活蹦乱跳的男人离奇死亡,死状恐怖,灵堂内的尸体忽然破棺而出,到底是诈尸还是另有隐情,我是刑警宁泽,带...
    沈念sama阅读 35,792评论 5 346
  • 正文 年R本政府宣布,位于F岛的核电站,受9级特大地震影响,放射性物质发生泄漏。R本人自食恶果不足惜,却给世界环境...
    茶点故事阅读 41,455评论 3 331
  • 文/蒙蒙 一、第九天 我趴在偏房一处隐蔽的房顶上张望。 院中可真热闹,春花似锦、人声如沸。这庄子的主人今日做“春日...
    开封第一讲书人阅读 32,003评论 0 22
  • 文/苍兰香墨 我抬头看了看天上的太阳。三九已至,却和暖如春,着一层夹袄步出监牢的瞬间,已是汗流浃背。 一阵脚步声响...
    开封第一讲书人阅读 33,130评论 1 272
  • 我被黑心中介骗来泰国打工, 没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留,地道东北人。 一个月前我还...
    沈念sama阅读 48,348评论 3 373
  • 正文 我出身青楼,却偏偏与公主长得像,于是被迫代替她去往敌国和亲。 传闻我的和亲对象是个残疾皇子,可洞房花烛夜当晚...
    茶点故事阅读 45,047评论 2 355

推荐阅读更多精彩内容