java - 这种对象的使用是否多余和/或效率低下？-6ren

java - 这种对象的使用是否多余和/或效率低下？

转载作者：行者123 更新时间：2023-12-01 07:17:18

25

4

我对使用对象相当缺乏经验，所以我真的很想要一些输入。

我正在尝试从包含某些“不需要的单词”的列表中删除评论，评论和“不需要的单词”列表都在 ArrayList 对象中。

这是一个名为 FormHelper 的类的内部，该类包含私有(private)成员 comments 作为 ArrayList，auditList ArrayList 是在本地创建的一个名为 populateComments() 的成员函数，然后调用此函数(如下)。 PopulateComments() 由构造函数调用，因此该函数仅在创建 FormHelper 实例时调用一次。

private void filterComments(ArrayList <String> auditList) {
    for(String badWord : auditList) {
        for (String thisComment : this.comments) {
            if(thisComment.contains(badWord)) {
                int index = this.comments.indexOf(thisComment);
                this.comments.remove(index);
            }
        }
    }
}

我的实现方式感觉不太对劲，我还担心我使用 ArrayList 函数的效率低下。我的怀疑正确吗？

最佳答案

效率不是特别高。然而，找到更有效的解决方案并不简单。

让我们回到一个更简单的问题。

private void findBadWords(List <String> wordList, List <String> auditList) {
    for(String badWord : auditList) {
        for (String word : wordList) {
            if (word.equals(badWord)) {
                System.err.println("Found a bad word");
            }
        }
    }
}

假设wordList包含N个单词，auditList包含M个单词。一些简单的分析将表明内部循环被执行了N x M次。 N 因素是不可避免的，但 M 因素却令人不安。这意味着您要检查的“坏”词越多，检查所需的时间就越长。

有一个更好的方法来做到这一点:

private void findBadWords(List <String> wordList, HashSet<String> auditWords) {
    for (String word : wordList) {
        if (auditWords.contains(word))) {
            System.err.println("Found a bad word");
        }
    }
}

为什么这样更好？它更好(更快)，因为 HashSet::contains 不需要一次检查所有审核词。事实上，在最佳情况下，它不会检查其中任何一个(!)，而平均情况下只会检查其中一两个。 (我不会详细说明原因，但如果您想了解，请阅读有关哈希表的维基百科页面。)

<小时/>

但是你的问题更复杂。您正在使用 String::contains 来测试每个评论是否包含每个坏词。这不是一个简单的字符串相等测试(根据我的简化版本)。

要做什么？

一个潜在的解决方案是将评论拆分为单词数组(例如使用 String::split 然后使用 HashSet 查找方法。但是:

这会改变代码的行为。 (实际上，这是一种很好的方式:阅读Scunthorpe problem!)您现在只会匹配审核单词，因为它们是评论文本中的实际单词。
将字符串拆分为单词并不便宜。如果您使用 String::split ，则需要创建并使用 Pattern 对象来查找单词边界，为每个单词创建子字符串并将它们放入数组中。您可能可以做得更好，但这始终是一个不平凡的计算。

所以真正的问题是优化是否会带来返回。这最终取决于 M 的值；即您正在寻找的坏词数量。 M 越大，就越有可能将评论拆分成单词并使用 HashSet 来测试单词。

^{另一种可能的解决方案不涉及拆分评论。您可以获取审核单词列表并将它们组装成单个正则表达式，如下所示:\b(word-1|word-2|...|word-n)\b。然后将此正则表达式与 Matcher::find 结合使用来搜索每个评论字符串中的不良单词。性能将取决于 Java 平台中正则表达式引擎的优化能力。它有可能比 split 更快。}

<小时/>

我的建议是在开始之前对整个应用程序进行基准测试和分析。仅优化:

当基准测试表明进行此评论检查的请求的总体性能令人担忧时。 (如果没问题，就不要浪费时间优化。)
当分析表明此方法是性能热点时。 (真正的热点很可能在其他地方。如果是这样，您应该优化它们而不是此方法。)

请注意，在您考虑优化之前，我们假设您已经(充分)完成了您的应用程序并为其创建了一个现实的基准。 (过早优化是一个坏主意......除非您真的知道自己在做什么。)

关于java - 这种对象的使用是否多余和/或效率低下？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/56411332/

25

4

0

文章推荐： java - LocalDateTime 到特定时区

文章推荐： java - JHipster何时从JDL开始创建虚拟数据？

文章推荐： java - 需要有关 Instanceof 运算符中类型转换的信息

文章推荐： java - 为什么Java基类构造函数调用派生类的方法？

jQuery .on 效率
第一个 .on 函数比第二个更有效吗？ $( "div.container" ).on( "click", "p", function(){ }); $( "body" ).on( "click",
JavaScript 效率
已关闭。此问题不符合Stack Overflow guidelines 。目前不接受答案。这个问题似乎与 help center 中定义的范围内的编程无关。 . 已关闭 7 年前。 Improve
jQuery 效率
我有这样的查询: $('#tabContainer li'); JetBrains WebStorm IDE 将其突出显示为低效查询。它建议我改用这个: $('#tabContainer').find
Ruby 效率
我刚刚在 coursera ( https://www.coursera.org/saas/) 上听了一个讲座，教授说 Ruby 中的一切都是对象，每个方法调用都是在对象上调用发送方法，将一些参数传递
excel - 函数输入数据类型是否影响循环速度/效率
这可能是用户“不喜欢”的另一个问题，因为它更多的是与建议相关而不是与问题相关。我有一个在保存和工作簿打开时触发的代码。它在 f(白天与夜晚，日期与实际日期)中选择正确的工作表。周一到周三我的情况
performance - 效率:递归与循环
这只是我的好奇心，但是更有效的是递归还是循环？给定两个功能（使用通用lisp）： (defun factorial_recursion (x) (if (> x 0) (*
loops - For循环或While循环-效率
这可能是一个愚蠢的问题，但是while循环的效率与for循环的效率相比如何？我一直被教导，如果可以使用for循环，那我应该这样做。但是，实际上之间的区别是什么: $i = 0; while($i <
elasticsearch - elasticsearch排序与得分-效率？
我有一个Elasticsearch索引，其中包含几百万条记录。 (基于时间戳的日志记录) 我需要首先显示最新记录(即，按时间戳降序排列的记录) 在时间戳上排序desc是否比使用时间戳的函数计分功能更有
Java 效率 - 点与坐标
使用Point2D而不是double x和y值时，效率有很大差异吗？我正在开发一个程序，该程序有许多圆圈在屏幕上移动。他们各自从一个点出发，并越来越接近目的地(最后，他们停下来)。使用 .getC
Java ArrayList 效率
我正在编写一个游戏，并且有一个名为 GameObject 的抽象类和三个扩展它的类(Player、Wall 和 Enemy)。我有一个定义为包含游戏中所有对象的列表。 List objects; 当
javascript - 链接与创建新集合 - 效率
我是 Backbone 的初学者，想知道两者中哪一个更有效以及预期的做事方式。 A 型:创建一个新集合，接受先前操作的结果并从新集合中提取 key result = new Backbone.Coll
SQL 通配符搜索 - 效率？
最近，关于使用 LIKE 和通配符搜索 MS SQL 数据库的最有效方法存在争论。我们正在使用 %abc%、%abc 和 abc% 进行比较。有人说过，术语末尾应该始终有通配符 (abc%)。因此，根
java - Scala 效率
关闭。这个问题是opinion-based 。目前不接受答案。想要改进这个问题吗？更新问题，以便 editing this post 可以用事实和引文来回答它。 . 已关闭 8 年前。 Improv
java - setVisible() 效率
我想知道，这样做会更有效率吗: setVisible(false) // if the component is invisible 或者像这样: if(isVisible()){
c# - 很多insertQuerys - 效率
我有一个静态方法可以打开到 SQL Server 的连接、写入日志消息并关闭连接。我在整个代码中多次调用此方法(平均每 2 秒一次)。问题是 - 它有效率吗？我想也许积累一些日志并用一个连接插入它们
javascript - PHP生成jQuery——效率
这个问题在这里已经有了答案: Best practice to avoid memory or performance issues related to binding a large numbe
java - 石头剪刀布游戏 - 效率？
我为我的 CS 课(高中四年级)制作了一个石头剪刀布游戏，我的老师给我的 shell 文件指出我必须将 do while 循环放入运行者中，但我不明白为什么？我的代码可以工作，但她说最好把它写在运行者
java - 自定义数组包装类类型转换安全/效率
我正在编写一个需要通用列表的 Java 应用程序。该列表需要能够经常动态地调整大小，对此的明显答案是通用的Linkedlist。不幸的是，它还需要像通过调用索引添加/删除值一样频繁地获取/设置值。 A
php - MYSQL查询的问题(效率)
我的 Mysql 语句遇到了真正的问题，我需要将几个表连接在一起，查询它们并按另一个表中值的平均值进行排序。这就是我所拥有的... SELECT ROUND(avg(re.rating
java - 效率？这些代码之间有什么区别吗？
这个问题在这里已经有了答案: 关闭 10 年前。 Possible Duplicate: Is there a difference between i==0 and 0==i? 以下编码风格有什么

首页

博学

6Ren·AI

商城

java - 这种对象的使用是否多余和/或效率低下？