python - 为什么使用正则表达式 finditer() 而不是 findall()-6ren

python - 为什么使用正则表达式 finditer() 而不是 findall()

转载作者：行者123 更新时间：2023-11-28 20:39:04

26

4

如果 findall() 足够好，使用 finditer() 有什么好处？findall() 返回所有匹配项，而 finditer() 返回不能像静态列表那样直接处理的匹配对象。

例如:

import re
CARRIS_REGEX = (r'<th>(\d+)</th><th>([\s\w\.\-]+)</th>'
                r'<th>(\d+:\d+)</th><th>(\d+m)</th>')
pattern = re.compile(CARRIS_REGEX, re.UNICODE)
mailbody = open("test.txt").read()
for match in pattern.finditer(mailbody):
    print(match)
print()
for match in pattern.findall(mailbody):
    print(match)

输出:

<_sre.SRE_Match object at 0x00A63758>
<_sre.SRE_Match object at 0x00A63F98>
<_sre.SRE_Match object at 0x00A63758>
<_sre.SRE_Match object at 0x00A63F98>
<_sre.SRE_Match object at 0x00A63758>
<_sre.SRE_Match object at 0x00A63F98>
<_sre.SRE_Match object at 0x00A63758>
<_sre.SRE_Match object at 0x00A63F98>

('790', 'PR. REAL', '21:06', '04m')
('758', 'PORTAS BENFICA', '21:10', '09m')
('790', 'PR. REAL', '21:14', '13m')
('758', 'PORTAS BENFICA', '21:21', '19m')
('790', 'PR. REAL', '21:29', '28m')
('758', 'PORTAS BENFICA', '21:38', '36m')
('758', 'SETE RIOS', '21:49', '47m')
('758', 'SETE RIOS', '22:09', '68m')

我出于好奇问这个。

最佳答案

finditer() 返回一个迭代器，而 findall() 返回一个数组。迭代器只有在您通过调用 .next() 请求它时才会工作。 for 循环知道在迭代器上调用 .next()，这意味着如果您提前从循环中 break，则不会执行任何后续匹配。另一方面，数组需要完全填充，这意味着必须预先找到每个匹配项。

迭代器的内存和 CPU 效率更高，因为它们一次只需要加载一个项目。如果您要匹配一个非常大的字符串(百科全书可能是几百兆字节的文本)，试图一次找到所有匹配项可能会导致浏览器在搜索时挂起并可能耗尽内存。

关于python - 为什么使用正则表达式 finditer() 而不是 findall()，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/39421746/

26

4

0

文章推荐： iphone - 我们可以获取 iPhone 中配置的总电子邮件帐户吗？

文章推荐： python - 在 python 应用程序中集成 pytest(提供 fixture )

文章推荐： ios - NSPredicate 和核心数据 : retrieve objects among relationships

文章推荐： java - jmeter tcp 响应文本

序言 | findall 与另一个 findall 的结果列表
如何通过特定条件获取值，然后使用这些选定元素从其他事实系列中获取值？我有这个代码 %code, date, amount values1('AAA', date(02, 03, 2020), 100
python - BeautifulSoup，findAll 之后的 findAll？
我是 Python 的新手，主要需要它来从网站获取信息。在这里，我试图从网站底部获取简短的标题，但无法完全获取。 from bfs4 import BeautifulSoup import reque
python - findall 错误 - NoneType' 对象没有属性 'findall'
我不断收到错误“缺少 1 个必需的位置参数:'section_url'” 每次我尝试使用 findall 时都会收到此错误。刚开始学习 python，因此我们将不胜感激! from bs4 impo
node.js - 为每个 findall Sequelize findall 是可能的吗？
我有这张 table 。客户有项目，用户在项目中工作 Clients - id - name Projects - id - name - client_id Users - id - name Us
python - Beautiful Soup findAll() 对 findall() 的结果返回 TypeError
嗨，我是 Python 和 Beautiful 汤的新手。我试图仅从表格的某个部分获取文本。但似乎 findAll 的结果不是我可以再次运行 findAll 的 BeautifulSoup 类型。 s
jpa - findAll 与 Projections 中的 findAll 和 CrudRepository 发生冲突
登录 @ApiModel @Entity public class Login { @Id @GeneratedValue(strategy = GenerationType.AUTO
jpa - findAll 与 Projections 中的 findAll 和 CrudRepository 发生冲突
登录 @ApiModel @Entity public class Login { @Id @GeneratedValue(strategy = GenerationType.AUTO
java - Spring Data REST - 在不创建/搜索/findAll URL 的情况下覆盖存储库 findAll
有什么方法可以防止 Spring Data REST 为覆盖的存储库方法创建/search URL？例如，以下代码会生成一个/search/findAll URL，它复制了集合资源的功能: publ
java - Spring Data REST - 在不创建/搜索/findAll URL 的情况下覆盖存储库 findAll
有什么方法可以防止 Spring Data REST 为覆盖的存储库方法创建/search URL？例如，以下代码会生成一个/search/findAll URL，它复制了集合资源的功能: publ
java - Spring Data JpaRepository findAll(Iterable ids) + findAll(Sort 排序)
使用 Spring Data JpaRepository 可以通过某种排序获取给定 Id 的选择集合。这意味着我需要启用以下查询。我找到了一些 solution应用@NamedQuery 但我无法启用
node.js - Sequelize : findAll based on param if param is not null and just findAll if param is null
我正在尝试在我的 Express 应用程序中使用 Sequelize 获取数据，并使用 MSSQL 获取数据库。这是我的代码: getInstitution: function (req, res)
javascript - Sequelize.js/Node.js/Express.js : Tasks. findAll() 返回 TypeError:Cannot read property 'findAll' of undefined
代码应该在请求/tasks 时返回一个带有空任务的 JSON 对象，而是返回一条消息错误 - TypeError: cannot read property 'findAll' of undefine
python - 为什么 re.findall ('(ab)+' , 'abab' ) 返回 ['ab' ]= 同时 re.findall ('(ab)+?' , 'abab' ) 返回 ['ab' , 'ab' ]？
我的python版本是2.7.6 我知道 +? 是 + 的非贪婪版本。这样 re.findall('(ab)+?', 'abab') 将匹配尽可能少的 ab。结果 ['ab', 'ab'] 因此有
reactjs - Sequelize FindAll()
我正在使用 sequelize 从 mySql db 获取数据。这就是我如何使用它 const isProduct = await models.product.findAll({ where:
hibernate - findAll()不返回正确的对象类型
ItemTag对象包含一个Item对象和一个Tag对象。 (这些是Java域对象。) 这个简单的查询按预期工作。我返回一个ItemTags列表，并且可以完成ItemTags应该做的所有奇妙的事情: d
grails - 带有相似值的Grails findAll
试图简单地使用find all运行域对象的查询，并且它的行为不像我期望的那样: searchResults = Contact.findAll("from Contact as c where c.c
Groovy findAll 闭包参数
我想使用 groovy findAll 和我的参数来过滤闭包 filterClosure = { it, param -> it.getParam == param } 我现在如何在 findAl
java - findall() 并不总是从数据库中提取值吗？
我扩展了 CrudRepository 来创建一个名为 TaskDao 的类。我认为 taskDao.findall() 会从数据库中提取值。由于某种原因，taskDao.findall() 实际上返
grails - findAll()HQL不返回grails中的分页列表
我正在开发一个 grails 应用程序，在此我必须在 list.gsp 上应用过滤器框。当我使用以下查询(在我的服务中)进行过滤时，我得到了分页列表: def clientCriteria =
Python findall 正则表达式不起作用
我正在尝试创建一个正则表达式来查找 Perl 代码中的所有变量。变量如下所示:$variable_test。所以这是我使用的正则表达式: ^\$\w+$ 这给了我Python中的这一行: matc

首页

博学

6Ren·AI

商城

python - 为什么使用正则表达式 finditer() 而不是 findall()