gpt4 book ai didi

python - 文本识别

转载 作者:塔克拉玛干 更新时间:2023-11-03 05:43:08 26 4
gpt4 key购买 nike

假设我有一些字符串列表(在我的例子中是电影名称),现在我有一个新句子,其中包含字符串列表中的一个字符串。我如何找到句子有哪个字符串?例如:

list_of_strings = ['20th century women', 'green is gold ', 'fire at sea']
sentence = 'Official Trailer | Green is gold - Releasing Tomorrow'

对于上述情况,解决方案应该能够找到句子 包含green is gold。请建议可以使用哪种算法来解决此问题。 Python 中的实现/库也可以使用。

Sentences might contain little different spellings.

字符串列表有 10000-15000 个字符串。

最佳答案

它是对在给定输入文本中查找单词集出现的标准问题的轻微修改。 Aho-Corasick可以有效解决这个问题算法。您可以修改算法可用的源代码以满足您的需要。
虽然子字符串函数可以像其他人回答的那样帮助您,但它们适用于小输入。对于较大的输入字符串,您将需要一些线性时间算法。

关于python - 文本识别,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/39984928/

26 4 0
Copyright 2021 - 2024 cfsdn All Rights Reserved 蜀ICP备2022000587号
广告合作:1813099741@qq.com 6ren.com