- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我是 LuceneNet 的新手..我应该说非常新。我心中有一些疑问,在阅读了大量相关资料后无法消除。嗯,我所处的场景是,我将拥有大量 PDF/文档/Excel/图像,以及包含相关数据的网页。系统中有各种类型的用户,其中一些可以访问特定的 PDF/文档,有些则不能。我将在希望部署应用程序的地方使用 Azure。因此,如果用户搜索某些内容,我只想向他显示那些他有权查看的结果。如果我使用 LuceneNet 可以做到吗?另外,我希望跟踪特定文档/URL 等的点击次数,以便它可以显示在大多数搜索等中。那么是否可以使用 LuceneNet 来实现这一点?如果我想索引 PDF/Doc/Docx/XSL/XSLX/PPT/PPTX 等文件和其中的数据,我需要使用什么东西。我应该如何通过 LuceneNet 存储数据(索引数据)?我的意思是我应该将它存储在 BLOB 存储中吗?值得推荐吗??我希望我的应用程序应该是可扩展的。 LuceneNet 会支持我吗?我可以拥有其辅助角色的多个实例吗?重新索引如何发生?重新索引是否会重新生成所有索引,如果是的话,在重新索引期间我将能够搜索吗?抱歉问了这么多问题,所有问题的顺序也可能不正确。但我是边记忆边问的。
最佳答案
首先,我会推荐一本名为“Lucene In Action”的书,它是针对 Java 的,但它是基于 Lucene 版本 3.0.3,这恰好是当前的 Lucene.NET 版本。API 是相同的,因此它是一个很棒的起始资源。
要回答...1)Lucene.NET中是否可以只显示授权记录?是的..你可以通过多种方式做到这一点。如果需要,您可以按用户分隔索引,或者您可以添加其他字段并始终将这些字段包含在搜索查询中。
2) 是的,您也可以在 Lucene 中跟踪点击(您可以保留点击日志并根据需要插入它们)
3) 如果您想索引 PDF、Docs、Docx...您需要提取文本。 Lucene 不会为你做这件事。因此您可以使用 Office Automation(对于 Word Docs..其免费 API)。 API 是基本的,但如果您想要更成熟/需要花钱的东西,请选择 AsPose(.NET 库,可以完全满足您的需要)
4) 有一个库可以为您抽象 AzureDirectory 并使用 blob 存储。我不推荐它,因为它不适用于:Lucene 3.0.3,存在稳定性问题,并且它使用较旧的存储客户端 API(2.0 之前的版本)。我将使用 Azure IaaS 虚拟机并将 Lucene 索引存储在磁盘上。如果需要,您可以随时扩展和添加更多磁盘,并对磁盘进行 strip 化。
5) 您应该只有一个 IndexWriter,但可以有多个索引搜索器。
6) 从 Lucene 2.9.x 开始,您可以进行“实时”搜索,您可以在其中更新索引,并且执行查询的搜索器可以在没有索引的情况下“近乎”实时地获取新数据完全投入/冲淡。
关于azure - LuceneNet 是如何工作的以及以下场景的实现可行性?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/13476364/
似乎有很多方法可以在 Azure 中自动使用 PowerShell。由于 ARM 模板是最新的,Azure 中的其他 PowerShell 选项是否已过时?这些工具/脚本之间有什么区别: Azure
我正在开发一个将托管在 Azure 中的 Web API。我想使用 Azure 诊断将错误记录到 Azure 表存储中。在经典门户中,我可以将日志配置为转到 Azure 表存储。 Classic Po
Azure 文件存储事件可以触发 Azure WebJob 或 Azure Function 吗? 例如,在文件夹“/todo/”中创建文件时。 最佳答案 我们目前没有任何 Azure 文件绑定(bi
我需要创建一个逻辑应用程序,我的要求是,我需要从 azure data Lake Gen2 文件夹迁移 json 文件,并根据某些值需要将该 json 转换为 xml,然后将其发送到 SQL。 因此,
我使用 VS Code 创建了 1 个 node.js 和 1 个 java Azure Function 当我使用 VS Code 将这两个函数部署到 Azure 时,我最终获得了这么多 Azure
收集 Azure 诊断数据时,暂存槽是否也会将诊断数据发送到 WadPerformanceCounters 表? 如果是这样,我该如何关闭它?或者在阅读诊断信息时如何区分暂存/生产。 我不想显示有关我
您好,我是 Azure 的新手。我有 VS 2012 和 Azure SDK 2.1,当我使用模拟器运行我的 Web 应用程序时一切正常。但是当我在 azure 上部署时出现错误消息: Could n
我很难区分 Azure 订阅和 Azure 租户有何不同?我尝试使用示例来弄清楚,但每次我得出的结论是它们在某种程度上是相同的?如果租户是组织在注册 Microsoft 云服务时接收并拥有的 Azur
如果我想在 Azure Insights 中设置自定义指标集合,并以(近)实时的方式可视化其中一些指标,并查看聚合的历史数据,我应该使用 Azure Metrics Explorer 还是 Azure
我想了解具有以下配置的 Azure 数据工厂 (ADF) 的现实示例/用例: Azure 集成运行时 (AIR) 默认值 自托管集成运行时(SHIR) 其他问题: 这两种配置(AIR 和 SHIR)是
请参阅下面来自 Azure 服务总线的指标。想要识别请求数量中的背景噪音|流量较低时的响应。假设振荡请求| session 中 amqp 握手的响应是潜在的。只是不明白这是什么类型的握手?从总线接收的
此问题与 Azure 事件中心和 Azure 服务总线之间的区别无关。 问题如下: 如果您将Azure Events Hub添加到您的应用程序中,那么您会注意到它依赖于Azure Service Bu
这两个事情是完全不同的,还是它们能完成的事情大致相同/相似? 最佳答案 Azure 辅助角色是“应用程序场”中您自己的一组虚拟机。您可以以分布式方式在它们上运行任何代码。通常,您编写业务代码以在这些服
我目前正在使用 Windows Azure 虚拟机来运行 RStudio, 我的虚拟机是 Windows Server R2 2012,它是 Azure 上的一项附加服务。 我还有一个 Azure 存
我们正在寻找托管一个网站(一些 css、js、一个 html 文件,但不是 aspx、一个通用处理程序)。 我们部署为: 1) Azure 网站 2) Azure 云服务 两种解决方案都有效。但有一个
我想从 Azure 表创建 blob。 AzCopy 支持此功能,但我找不到任何说明数据移动 API 也支持它的文档。此选项可用吗? https://azure.microsoft.com/en-us
This article表示 Azure 订阅所有者有权访问订阅中的所有资源。但是,要访问 Azure 数据库,必须是数据库中的用户,或者是 Azure Admin AD 组的成员。 无论 SQL 安
我尝试使用以下代码将 XML 文件上传到 Azure FTP 服务器: https://www.c-sharpcorner.com/article/upload-and-download-files-
除了 Azure 服务总线使用主题而 Azure 事件中心基于事件 - Azure 事件中心和 Azure 服务总线之间是否有任何根本区别? 对我来说,事件和消息之间没有真正的区别,因为两者只是不同类
我有一个通过虚拟网络网关连接到 Azure 虚拟网络的 Windows VPN 客户端。目标#1 是使用其内部 IP 地址连接到我的虚拟机。这有效。 第二个目标是使用其内部计算机名称进行连接(因为 I
我是一名优秀的程序员,十分优秀!