- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我正在使用演示 IndexFiles 和 SearchFiles 类来索引和搜索 org.apache.lucene.demo 数据包中的内容。
我的问题是,当我使用包含多个单词的查询时,我没有得到完全匹配的结果。例如:
Enter query:
"natural language"
Searching for: "natural language"
298 total matching documents
1. download\researchers.uq.edu.au\fields-of-research\natural-language-processing
.txt
2. download\researchers.uq.edu.au\research-project\16267.txt
3. download\researchers.uq.edu.au\research-project\16279.txt
4. download\researchers.uq.edu.au\research-project\18361.txt
5. download\www.uq.edu.au\news\%3Farticle%3D2187.txt
6. download\researchers.uq.edu.au\researcher\2115.txt
7. download\ceit.uq.edu.au\content\2013-2014-summer-research-scholarship-project
s-dr-alan-cody%3Fpage%3D1.txt
8. download\ceit.uq.edu.au\content\2013-2014-summer-research-scholarship-project
s-dr-alan-cody%3Fpage%3D2.txt
9. download\ceit.uq.edu.au\content\2013-2014-summer-research-scholarship-project
s-dr-alan-cody.txt
10. download\www.ceit.uq.edu.au\content\2013-2014-summer-research-scholarship-pr
ojects-dr-alan-cody.txt
Press (n)ext page, (q)uit or enter number to jump to a page.
与以下结果不同:
Enter query:
natural language
Searching for: natural language
54307 total matching documents
1. download\cyberschool.library.uq.edu.au\display_resource.phtml%3Frid%3D190.txt
2. download\cyberschool.library.uq.edu.au\display_resource.phtml%3Frid%3D576.txt
3. download\cyberschool.library.uq.edu.au\display_resource.phtml%3Frid%3D46.txt
4. download\espace.library.uq.edu.au\view\UQ%3A166163.txt
5. download\cyberschool.library.uq.edu.au\display_resource.phtml%3Frid%3D108.txt
6. download\cyberschool.library.uq.edu.au\display_resource.phtml%3Frid%3D70.txt
7. download\cyberschool.library.uq.edu.au\display_resource.phtml%3Frid%3D708.txt
8. download\researchers.uq.edu.au\fields-of-research\natural-language-processing
.txt
9. download\researchers.uq.edu.au\research-project\16267.txt
10. download\cyberschool.library.uq.edu.au\display_resource.phtml%3Frid%3D117.tx
t
Press (n)ext page, (q)uit or enter number to jump to a page.
例如,第一个匹配文档甚至不包含“语言”关键字。
如果我在 IndexSearcher
类中使用 explain()
方法,那么我将得到第一个结果:
1. download\cyberschool.library.uq.edu.au\display_resource.phtml%3Frid%3D190.txt
0.70643383 = (MATCH) sum of:
0.5590494 = (MATCH) weight(contents:natural in 62541) [DefaultSimilarity], result of:
0.5590494 = score(doc=62541,freq=4.0 = termFreq=4.0
), product of:
0.8091749 = queryWeight, product of:
4.4216847 = idf(docFreq=13111, maxDocs=401502)
0.18300149 = queryNorm
0.6908882 = fieldWeight in 62541, product of:
2.0 = tf(freq=4.0), with freq of:
4.0 = termFreq=4.0
4.4216847 = idf(docFreq=13111, maxDocs=401502)
0.078125 = fieldNorm(doc=62541)
0.1473844 = (MATCH) weight(contents:language in 62541) [DefaultSimilarity], result of:
0.1473844 = score(doc=62541,freq=1.0 = termFreq=1.0
), product of:
0.5875679 = queryWeight, product of:
3.2107275 = idf(docFreq=44012, maxDocs=401502)
0.18300149 = queryNorm
0.25083807 = fieldWeight in 62541, product of:
1.0 = tf(freq=1.0), with freq of:
1.0 = termFreq=1.0
3.2107275 = idf(docFreq=44012, maxDocs=401502)
0.078125 = fieldNorm(doc=62541)
如果我单击“下一步”并找到如下结果:
19. download\www.uq.edu.au\news\%3Farticle%3D2187.txt
0.47449595 = (MATCH) sum of:
0.2795247 = (MATCH) weight(contents:natural in 35173) [DefaultSimilarity], result of:
0.2795247 = score(doc=35173,freq=4.0 = termFreq=4.0
), product of:
0.8091749 = queryWeight, product of:
4.4216847 = idf(docFreq=13111, maxDocs=401502)
0.18300149 = queryNorm
0.3454441 = fieldWeight in 35173, product of:
2.0 = tf(freq=4.0), with freq of:
4.0 = termFreq=4.0
4.4216847 = idf(docFreq=13111, maxDocs=401502)
0.0390625 = fieldNorm(doc=35173)
0.19497125 = (MATCH) weight(contents:language in 35173) [DefaultSimilarity], result of:
0.19497125 = score(doc=35173,freq=7.0 = termFreq=7.0
), product of:
0.5875679 = queryWeight, product of:
3.2107275 = idf(docFreq=44012, maxDocs=401502)
0.18300149 = queryNorm
0.33182758 = fieldWeight in 35173, product of:
2.6457512 = tf(freq=7.0), with freq of:
7.0 = termFreq=7.0
3.2107275 = idf(docFreq=44012, maxDocs=401502)
0.0390625 = fieldNorm(doc=35173)
哪个页面本身包含确切的关键字“自然语言”。所以我的问题是:
1)为什么Lucene不首先显示精确匹配?
2)为什么Lucene显示的结果甚至不包含关键字?
3)我可以在哪里/如何更改它,以便它首先显示完全匹配的内容,然后显示更相关的内容?
最佳答案
1 - 无意这样做。请参阅 Lucene query syntax 上的文档。查询自然语言
是由两个术语组成的查询。就其本身而言,Lucene 并不偏好将这些术语放在一起。如果您想找到完全匹配的内容,短语查询是正确的方法,例如 "natural language"
2 - 您包含解释的两个结果均包含这两个术语的匹配项,请参阅:
0.2795247 = (MATCH) weight(contents:natural in 35173) [DefaultSimilarity], result of:
0.2795247 = score(doc=35173,freq=4.0 = termFreq=4.0
...
0.19497125 = (MATCH) weight(contents:language in 35173) [DefaultSimilarity], result of:
0.19497125 = score(doc=35173,freq=7.0 = termFreq=7.0
根据 Lucene 的说法,它在该文档中发现了 4 次“自然”一词,在内容字段(我假设是您的默认字段)中发现了 7 次“语言”。
3 - 查看查询解析器语法,看看什么对您最有意义。听起来你可能会发现 Proximity Searches有用。
如果您只想简单地获得短语匹配,然后是其他短语,您可以使用以下内容:
"natural language" natural language
关于java - Lucene:首先不显示精确匹配,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/19217634/
我的Angular-Component位于一个flexbox(id =“log”)中。可以显示或隐藏flexbox。 我的组件内部有一个可滚动区域,用于显示日志消息。 (id =“message-li
我真的很困惑 有一个 phpinfo() 输出: MySQL 支持 启用 客户端 API 版本 5.5.40 MYSQL_MODULE_TYPE 外部 phpMyAdmin 显示: 服务器类型:Mar
我正在研究这个 fiddle : http://jsfiddle.net/cED6c/7/我想让按钮文本在单击时发生变化,我尝试使用以下代码: 但是,它不起作用。我应该如何实现这个?任何帮助都会很棒
我应该在“dogs_cats”中保存表“dogs”和“cats”各自的ID,当看到数据时显示狗和猫的名字。 我有这三个表: CREATE TABLE IF NOT EXISTS cats ( id
我有一个字符串返回到我的 View 之一,如下所示: $text = 'Lorem ipsum dolor ' 我正在尝试用 Blade 显示它: {{$text}} 但是,输出是原始字符串而不是渲染
我无法让我的链接(由图像表示,位于页面左侧)真正有效地显示一个 div(包含一个句子,位于中间)/单击链接时隐藏。 这是我的代码: Practice
关闭。这个问题需要多问focused 。目前不接受答案。 想要改进此问题吗?更新问题,使其仅关注一个问题 editing this post . 已关闭 4 年前。 Improve this ques
最初我使用 Listview 来显示 oracle 结果,但是最近我不得不切换到 datagridview 来处理比 Listview 允许的更多的结果。然而,自从切换到数据网格后,我得到的结果越来越
我一直在尝试插入一个 Unicode 字符 ∇ 或 ▽,所以它显示在 Apache FOP 生成的 PDF 中。 这是我到目前为止所做的: 根据这个基本帮助 Apache XSL-FO Input,您
我正在使用 node v0.12.7 编写一个 nodeJS 应用程序。 我正在使用 pm2 v0.14.7 运行我的 nodejs 应用程序。 我的应用程序似乎有内存泄漏,因为它从我启动时的大约 1
好的,所以我有一些 jQuery 代码,如果从下拉菜单中选择了带有前缀 Blue 的项目,它会显示一个输入框。 代码: $(function() { $('#text1').hide();
当我试图检查 Chrome 中的 html 元素时,它显示的是 LESS 文件,而 Firefox 显示的是 CSS 文件。 (我正在使用 Bootstrap 框架) 如何在 Chrome 中查看 c
我是 Microsoft Bot Framework 的新手,我正在通过 youtube 视频 https://youtu.be/ynG6Muox81o 学习它并在 Ubuntu 上使用 python
我正在尝试转换从 mssql 生成的文件到 utf-8。当我打开他的输出 mssql在 Windows Server 2003 中使用 notepad++ 将文件识别为 UCS-2LE我使用 file
很难说出这里问的是什么。这个问题是含糊的、模糊的、不完整的、过于宽泛的或修辞性的,无法以目前的形式得到合理的回答。如需帮助澄清此问题以便重新打开它,visit the help center 。 已关
我正在尝试执行单击以打开/关闭一个 div 的功能。 这是基本的,但是,点击只显示 div,当我点击“关闭”时,没有任何反应。 $(".inscricao-email").click(function
假设我有 2 张卡片,屏幕上一次显示一张。我有一个按钮可以用其他卡片替换当前卡片。现在假设卡 1 上有一些数据,卡 2 上有一些数据,我不想破坏它们每个上的数据,或者我不想再次重建它们中的任何一个。
我正在使用 Eloquent Javascript 学习 Javascript。 我在 Firefox 控制台上编写了以下代码,但它返回:“ReferenceError:show() 未定义”为什么?
我正在使用 Symfony2 开发一个 web 项目,我使用 Sonata Admin 作为管理面板,一切正常,但我想要做的是,在 Sonata Admin 的仪表板菜单上,我需要显示隐藏一些菜单取决
我试图显示一个div,具体取决于从下拉列表中选择的内容。例如,如果用户从列表中选择“现金”显示现金div或用户从列表中选择“检查”显示现金div 我整理了样本,但样本不完整,需要接线 http://j
我是一名优秀的程序员,十分优秀!