- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我用下面的代码把一张图片分成了 block
block = []
for x in range(0, 224,16):
for y in range(0, 224,16):
block.append(im[y:y+16, x:x+16])
np_block = np.array(block)
图像形状为224,224,3
,每个 block 为16,16,3
。如何将这些 block 组合在一起形成完整的图像?当我 reshape 它 (np_block.reshape(224, 224,3)
) 时,我得到了下图,它与真实图像完全不同
编辑:这已在评论部分回答如下:
reshaped_img = np_block.reshape(14,14,16,16,3).transpose(0,3,1,2,4).reshape(14*16,14*16,3)
与原始图像相比,生成的图像进行了旋转和翻转。这是原图
这是将 block 合并在一起的方法生成的图像
执行 restored_img = np.flip(np.rot90(reshaped_img, k=1, axes=(0, 1)), axis=0)
会正确地将生成的图像恢复为其原始形式.
但是,在pytorch中将restored_img
转换为tensor,tensor_img = torch.from_numpy(restored_img)
会抛出如下错误:
ValueError: At least one stride in the given numpy array is negative, and tensors with negative strides are not currently supported. (You can probably work around this by making a copy of your array with array.copy().)
我按照错误消息中的建议解决了这个问题。
tensor_img = torch.from_numpy(restored_img.copy())
消除了错误,但未保留对 restored_img
进行的转换(旋转和翻转)。 tensor_img
仍然与上面最后一张图片相同。
我注意到在拆分原始图像时,拆分块没有以正确的顺序附加。当我可视化它时,这在 np_block
中很明显(上面的第一张图片看起来翻转和旋转)。因此,我将 block.append(im[y:y+16, x:x+16])
行更改为 block.append(im[x:x+16, y: y+16])
重新可视化 np_block
因此得到以下图像
这看起来更接近原始图像,而且 block 看起来也以正确的顺序排列(这是我观察到的)。但是这些 block 彼此不重叠。
请问我该如何解决这个问题?
最佳答案
您好,最初提出的解决方案的问题是您必须重新排列 block 0,3
和 1,2
如果您交换这些维度,那么它就会得到解决.检查:
block = [] #create blocks
for x in range(0, 224,16):
for y in range(0, 224,16):
block.append(im[y:y+16, x:x+16])
np_block = np.array(block)
reshaped_img = np_block.reshape(14,14,16,16,3).transpose(1,2,0,3,4).reshape(14*16,14*16,3)
#check indices are now (1,2,0,3,4) instead of (0,3,1,2,4)
plt.imshow(np.hstack([im,reshaped_img]))
编辑
同样来自原始评论,这只是转置输出维度reshaped_img.transpose(1,0)
,但如果你能在原来的 reshape 中纠正它是一个更好的解决方案
编辑2
使用更正后的堆叠(x 在第一维)代码将是:
block = []
for x in range(0, 224,16):
for y in range(0, 224,16):
block.append(im[x:x+16, y:y+16])
np_block = np.array(block)
reshaped_img = np_block.reshape(14,14,16,16,3).transpose(0,2,1,3,4).reshape(14*16,14*16,3)
这里有莫尔斯意义: block 中 reshape 的第一个维度 (dim 0) 与子 block 的第一个维度 (dim 2) 被分组,然后 block 的第二个维度和子 block (1, 3).
在任何情况下,您都可以通过以下方式检查好的解决方案:
plt.imshow(np.hstack([im,reshaped_img]))
编辑 3最后一次编辑,这里是检查原始 block reshape 的代码(使用编辑 2 的代码)。在这里你可以看到每个 block 都有一些图像中的切割感:
b = np_block.reshape(14,14,16,16,3)
plt.figure()
for i in range(14):
for j in range(14):
plt.subplot(14,14,14*i+j+1)
plt.imshow(b[i,j])
plt.axis('off')
关于python - 分割成 block 后如何合并图像,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/72764481/
实际上我只需要用JAVA编写一个简单的程序来将MySQL INSERTS行转换为CSV文件(每个mysql表等于一个CSV文件) 在JAVA中使用正则表达式是最好的解决方案吗? 我的主要问题是如何正确
我有一个 txt 文件,其格式为: Key:value Key:value Key:value ... 我想将所有键及其值放入我创建的 hashMap 中。如何让 FileReader(file) 或
已关闭。此问题不符合Stack Overflow guidelines 。目前不接受答案。 要求提供代码的问题必须表现出对所解决问题的最低限度的了解。包括尝试的解决方案、为什么它们不起作用以及预期结果
我每周都会从我的主机下载数据库的备份。它生成一个 .sql 文件,当前大小约为 800mb。此 .sql 文件包含 44 个表。 有什么方法可以通过某些软件将 .sql 文件与所有表分开,以便单独导出
在 iOS 4.0 及更高版本中,有没有一种方法可以在不将整个图像加载到内存的情况下对 CGImage 进行分割?我试图做的是*以编程方式*分割图像,以便在使用大图像的 CATiledLayer 应用
我的 .split() 函数有问题,我有以下字符串: var imageUrl = "Images\Products\randomImage.jpg"; 我想用字符“\”分割,但是,这种情况发生了:
是否可以使用正则表达式将字符串拆分两次?例如,假设我有字符串: example=email@address.com|fname|lname 如何拆分结果为: email@address.com,fna
我正在寻找一种在线程系统(主从)中使用数组的解决方案,它允许我通过用户输入在多个线程上划分矩阵的计算,并将其通过 1 个主线程引导到多个从属线程,这些从属线程计算矩阵的 1 个字段。 我尝试运用我的知
我建立了一个系统来分割包含手写符号的二值图像并对它们进行分类(专门用于音乐)。我知道有商业应用程序可以执行此操作,但这是我尝试将其作为一个项目从头开始。 为了简单起见,假设我的整个图像中有两个元素:
我正在尝试找到一种可接受的复杂性的有效方法 检测图像中的对象,以便将其与周围环境隔离 将该对象分割成它的子部分并标记它们,这样我就可以随意获取它们 我进入图像处理世界已经 3 周了,我已经阅读了很多算
我有一组3D 空间中的点。下图是一个示例: 我想把这些点变成一个面。我只知道点的 X、Y 和 Z 值。例如,查看下图,它显示了从 3D 空间中的点生成的人脸网格。 我在谷歌上搜索了很多,但我找到的是一
我有一个字符串 String placeStr="place1*place2*place3"我想获取包含 place1、place2、place3 的数组,如下所示: String[] places=
我在 Python 中有一个类似于 google.com 的字符串,我想将其分成两部分:google 和 .com。问题是我有一个 URL,例如 subdomain.google.com,我想将其拆分
朋友需要对一个pdf文件进行分割,在网上查了查发现这个pypdf2可以完成这些操作,所以就研究了下这个库,并做一些记录。首先pypdf2是python3版本的,在之前的2版本有一个对应pypdf库。
伙计们,这是一个难以解决的问题,因为它涉及很多硬件细节,所以我想把它放到 EE.SE,但它的主要重点是编程,所以我决定坚持在这里。 我最近怀旧(以及渴望回到 CPU 内在函数),所以我决定自制一个 8
给定 haskell 中的排序列表,我如何获得分段列表,其中连续数字位于同一列表中。例如,如果我有一个排序列表 [1,2,3,4,7,8,10,12,13,15] 结果将是 [[1,2,3 ,4],[
如果我添加三个分割 View ,如下图所示,第三个分割 View (称为 splitView-3)将自动为该分割 View 中的自定义 View 生成约束,例如 customview1 的 Heigh
关闭。此题需要details or clarity 。目前不接受答案。 想要改进这个问题吗?通过 editing this post 添加详细信息并澄清问题. 已关闭 6 年前。 Improve th
如何为馈送给映射器的文件的每一行提供相同文件的拆分? 基本上我想做的是 for each line in file-split { for each line in file{
带有Snappy压缩功能的ORC文件是否可拆分成条形? 据我所知,Snappy Compressed File是不可拆分的。 但我在博客中读到,快速压缩的文件可以在 strip 上拆分。 真的吗? 最
我是一名优秀的程序员,十分优秀!