python - 有没有办法更快地运行 OpenCV 的 SIFT？-6ren

python - 有没有办法更快地运行 OpenCV 的 SIFT？

转载作者：行者123 更新时间：2023-12-02 16:15:56

26

4

我有一个图像目录，其中包含许多未识别的重复项。我的目标是识别重复项。由于重复项已被裁剪、调整大小或转换为不同的图像格式，因此无法通过比较它们的哈希值来检测它们。

我编写了一个成功检测重复项的脚本，但有一个主要缺点:脚本速度很慢。在一个包含 60 个项目的文件夹的测试驱动器上，运行需要五个小时(这也可能反射(reflect)了我越来越多的错误和缓慢的计算机)。由于我的目录中有大约 66,000 张图像，我估计脚本需要 229 天才能完成。

谁能提出解决方案？我的research已经透露，您可以通过在循环完成时“释放”存储在变量中的图像来释放内存，但是有关如何执行此操作的所有信息似乎都是用 C 编写的，而不是 python。我也在考虑尝试使用 orb而不是筛选，但担心其准确性。有没有人对这两种选择中哪一种更适合提出建议？或者重写脚本以减少内存占用的方法？非常感谢。

from __future__ import division

import cv2
import numpy as np
import glob
import pandas as pd
   

listOfTitles1 = []
listOfTitles2 = []
listOfSimilarities = []
    
    # Sift and Flann
sift = cv2.xfeatures2d.SIFT_create()


index_params = dict(algorithm=0, trees=5)
search_params = dict()
flann = cv2.FlannBasedMatcher(index_params, search_params)

# Load all the images1

countInner = 0
countOuter = 1

folder = r"/Downloads/images/**/*"

for a in glob.iglob(folder,recursive=True):
    for b in glob.iglob(folder,recursive=True):
    
        if not a.lower().endswith(('.jpg','.png','.tif','.tiff','.gif')):

            continue

        if not b.lower().endswith(('.jpg','.png','.tif','.tiff','.gif')):

            continue

        if b.lower().endswith(('.jpg','.png','.tif','.tiff','.gif')):

            countInner += 1
        
        print(countInner, "", countOuter)
    
        if countInner <= countOuter:

            continue

        image1 = cv2.imread(a)
        kp_1, desc_1 = sift.detectAndCompute(image1, None)
    
        image2 = cv2.imread(b)
        kp_2, desc_2 = sift.detectAndCompute(image2, None)

        matches = flann.knnMatch(desc_1, desc_2, k=2)

        good_points = []

        if good_points == 0:

            continue

        for m, n in matches:
            if m.distance < 0.6*n.distance:
                good_points.append(m)

        number_keypoints = 0
        if len(kp_1) >= len(kp_2):
            number_keypoints = len(kp_1)
        else:
            number_keypoints = len(kp_2)
            
        percentage_similarity = float(len(good_points)) / number_keypoints * 100

        listOfSimilarities.append(str(int(percentage_similarity)))
        listOfTitles2.append(b)

        listOfTitles1.append(a)
        
    countInner = 0
    if a.lower().endswith(('.jpg','.png','.tif','.tiff','.gif')):
        countOuter += 1

zippedList =  list(zip(listOfTitles1,listOfTitles2, listOfSimilarities))

print(zippedList)

dfObj = pd.DataFrame(zippedList, columns = ['Original', 'Title' , 'Similarity'])

dfObj.to_csv(r"/Downloads/images/DuplicateImages3.csv")

最佳答案

我认为通过简单的更改可以获得显着的性能提升:

首先，由于您对比较图像对感兴趣，因此您的循环可能如下所示:

files = ... # preload all file names with glob

for a_idx in range(len(files)):
  for b_idx in range(a_idx, len(files)): # notice loop here
    image_1 = cv2.imread(files[a_idx])
    image_2 = cv2.imread(files[b_idx])

这会考虑所有对而不重复，例如(a, b) && (b, a)

其次，在比较每个 b 时，您不需要重新计算 a 的特征

for a_idx in range(len(files)):
  image_1 = cv2.imread(files[a_idx])
  kp_1, desc_1 = sift.detectAndCompute(image1, None) # never recoompute SIFT!

  for b_idx in range(a_idx, len(files)):
    image_2 = cv2.imread(files[b_idx])
    kp_2, desc_2 = sift.detectAndCompute(image2, None)

我还会检查图片尺寸。我的猜测是有一些非常大的东西正在减慢你的内部循环。即使所有 60*60 == 3600 对也不应该花那么长时间。如果图像真的很大，您可以对其进行降采样以提高效率。

关于python - 有没有办法更快地运行 OpenCV 的 SIFT？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/62766942/

26

4

0

文章推荐： python - OpenCV在视频中查找卡住的帧

文章推荐： python - img [y:y + h，x:x + w]坐标系的工作方式

文章推荐： python - 函数 'cvSetMouseCallback'中的NULL窗口处理程序

文章推荐： python - python opencv检测图像完全白

.net - 有没有.Net云平台
就目前而言，这个问题不适合我们的问答形式。我们希望答案得到事实、引用或专业知识的支持，但这个问题可能会引起辩论、争论、投票或扩展讨论。如果您觉得这个问题可以改进并可能重新打开，visit the he
xcode - 有没有[转到文件...]？
在现代 IDE 中，有一个键盘快捷键可以通过键入文件名称来打开文件，而无需将手放在鼠标上。例如: Eclipse:Cmd|Ctrl + Shift + R -> 打开资源 IntelliJ:Cmd|C
c# - 有没有 "When"类型的东西？
有什么东西会等待事件发生(我正在等待的是 WebBrowser.DocumentCompleted)，然后执行代码吗？像这样: If (WebBrowser.DocumentCompleted) 不会
PHP 自动缩小。有没有？
我使用 PHP Minify，它很棒。但我的问题是，是否有任何 PHP 插件或其他东西可以自动检测 javascript/css 代码并自动缩小它？谢谢。最佳答案 Javascript 压缩器？看
windows - 有没有 'compiles'到windows批处理语法的脚本语言？
有没有一种语言，类似什么CoffeeScript是JavaScript，编译成windows batch|cmd|command line的语言？我指的cmd版本是基于NT的，尤其是XP sp3及以
ant - 有没有 Ant 任务可以复制不丢失权限
我知道我可以，但是，我真的宁愿有一个任务，我可以从任何可以使用所有(或至少大部分)属性的操作系统调用 copy ，但这并没有消除 unix 上的权限。我想知道是否已经有解决方案，或者我必须自己编
javascript - 有没有 jvectormap 的替代品
我正在使用 Vuejs(不使用 jQuery)开发一个项目，该项目需要像 jvectormap 这样的 map 但正如我所说，我没有使用 jQuery，那么是否有任何其他库可以在不使用 jQuery
jquery - 有没有 jQuery 投票插件？
想要进行一个简单的民意调查，甚至不需要基于 cookie，我不在乎投了多少票。有没有类似的插件或者简单的东西？最佳答案这是一个有用的教程 - 让我知道它是否适合您 using jQuery to
jquery - 有没有 jquery 下拉年份选择器
已结束。此问题正在寻求书籍、工具、软件库等的推荐。它不满足Stack Overflow guidelines 。目前不接受答案。我们不允许提出寻求书籍、工具、软件库等推荐的问题。您可以编辑问题，以便
iphone - 有没有 iPhone 友好的反馈服务
就目前情况而言，这个问题不太适合我们的问答形式。我们希望答案得到事实、引用资料或专业知识的支持，但这个问题可能会引发辩论、争论、民意调查或扩展讨论。如果您觉得这个问题可以改进并可能重新开放，visit
delphi - 有没有 "Pos"函数来查找字节？
var FileBuff: TBytes; Pattern: TBytes; begin FileBuff := filetobytes(filename); Result := Co
javascript - 有没有 "vqmod"允许多图片上传？
我想要一个 vqmod xml 文件来添加一次上传多个图像的功能。身边有这样的事吗？编辑:Opencart版本:2.1.0.1 最佳答案最后我写了一个xml来添加到opencart 2.1.0.1
java - 有没有 'clean' 方法来省略静态类型声明？
所以考虑这样的函数: public void setTemperature(double newTemperatureValue, TemperatureUnit unit) 其中Temperatur
arangodb - 有没有 arangoDB 的工具
已关闭。此问题不符合Stack Overflow guidelines 。目前不接受答案。要求我们推荐或查找工具、库或最喜欢的场外资源的问题对于 Stack Overflow 来说是偏离主题的，因为
r - 有没有 ggplot2 的美学表格或目录？
我是 ggplot2 的新手，一直在尝试找到一个全面的美学列表。我想我理解它们的目的，但很难知道哪些可以在各种情况下使用(主要是几何图形？)。 Hadley 的网站偶尔会在各个几何图形的页面上列出可用
php - 有没有 'fun'交互式主页的好例子？这里有关于创建此类交互性的教程吗？
就目前情况而言，这个问题不太适合我们的问答形式。我们希望答案得到事实、引用资料或专业知识的支持，但这个问题可能会引发辩论、争论、民意调查或扩展讨论。如果您觉得这个问题可以改进并可能重新开放，visit
javascript - 有没有 PHP 函数可以将数字转换为带有千位分隔符的货币？
是否有任何 PHP 函数可以将整数转换为十万和千万？ 900800 -> 9,00,800 500800 -> 5,00,800 最佳答案由于您已在问题标签中添加了 Yii，因此您可以按照 Yii
clojure - 有没有 Clojure 核心模块的惰性函数的完整列表？
使用 Clojure 一段时间后，我积累了一些关于它的惰性的知识。我知道诸如map之类的常用API是否是惰性的。然而，当我开始使用一个不熟悉的API(例如with-open)时，我仍然感到怀疑。是否
wpf - 有没有 AvalonDock 的更新替代品？
我的项目需要一个像 AvalonDock 这样的对接系统，但它的最后一次更新似乎是在 2013 年 6 月。是否有更多...积极开发的东西可以代替它？最佳答案 AvalonDock 实际上相当成熟并
clojure - 有没有 html 解析器来打嗝结构？
我正在寻找一个可以逆转 clojure 打嗝的函数所以 turns into [:html] 等等根据@kotarak的回答，这现在对我有用: (use 'net.cgrand.enliv

首页

博学

6Ren·AI

商城

python - 有没有办法更快地运行 OpenCV 的 SIFT？