- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我正在创建一个 SQL 脚本,其中我必须从文本字段 (varchar(max)) 中输出 n(用户输入)个单词,从另一个表中指定的单词(搜索词)开始。因此,例如,我的文本字符串是“The quick brown fox jumps over the lazy dog”,我想从单词“brown”中输出 3 个单词。所以,我的输出应该是“brown fox jumps over”。
此操作需要在一组两个不同的表上运行。第一个表将包含来自多个文档的文本字段。第二个表将包含一些搜索词(上面场景中的“棕色”一词),我们将从这些词开始生成输出。 (如果我对这部分不清楚,请告诉我)。
我编写了一个代码,但在语法或对 SQL 位的理解方面出了问题。以下是生成错误的代码片段。
SELECT @Loopcounter = 0,
@Termcount = Count([termName])
FROM #temp_table -- temp_table contains the list of search terms
WHILE ( @Loopcounter < @Termcount )
BEGIN
SELECT @SearchTerm = [termName] FROM #temp_table ORDER BY RowNum
OFFSET @Loopcounter ROWS
FETCH NEXT 1 ROWS ONLY -- to iterate all the search terms in temp_table on all documents
SET @Spacecounter = 0;
SET @Lastword = 0;
SELECT
[DocID],
[ExtractedText],
(
SELECT @Lastword = CHARINDEX( @SearchTerm, ExtractedText ) --position of search term in text field of a document
FROM [EDDSDBO].[Document] t1 --contains the list of all documents and their text fields
WHERE d.ArtifactID = t1.ArtifactID -- to match the document id outside of the loop
WHILE ( @Spacecounter <= @Proxnum ) --@Proxnum is the number of words required by the user
-- this loop will find spaces after the search term and will give the position of @proxnum space after the search term
BEGIN
SELECT @Lastword = CHARINDEX( ' ', ExtractedText, @Lastword ) --to find the first space after the search term
FROM [EDDSDBO].[Document] t2
WHERE d.ArtifactID = t2.ArtifactID
SET @Lastword = @Lastword + 1
SET @Spacecounter = @Spacecounter + 1
END
SELECT SUBSTRING ( ExtractedText, CHARINDEX( @SearchTerm, ExtractedText ), @Lastword - CHARINDEX( @SearchTerm, ExtractedText ) )
FROM [EDDSDBO].[Document] t3 --to extract the words from starting of search term till the numbers of words required
WHERE d.ArtifactID = t3.ArtifactID
)
AS [After Hit]
FROM [EDDSDBO].[Document] d
WHERE CONTAINS ( ExtractedText, @SearchTerm) --to only search the document that contains that search term
SET @Loopcounter = @Loopcounter + 1
END
我知道那里有很多脚本,但上下文不多,但是如果有人可以帮助我解决这个问题,请发表您的答案。我假设我在 select 语句中调用循环时出错了,但我没有看到替代方法。
如果您需要更多上下文来理解此 SQL 脚本的要求,请告诉我。谢谢!
最佳答案
这并不容易。我在这上面花了太多时间,我相信 sql-server 有一些你可以安装或打开的文本搜索功能。尽管如此,这里的方法在很大程度上应该可以满足您的需要。您必须到处调整它,但它适用于我在下面提供的示例数据。
您永远不会知道您 future 的需求,因此您不太可能构建您的系统以实现灵 active 。所以这里有一个搜索表,它不仅有搜索词,还有一个列,用于显示要提取的词后的单词数:
declare @searches table (
termName nvarchar(50),
wordsAfter int,
rowNum int identity(1,1)
);
insert @searches values
('brown', 3),
('green', 2);
然后这是一个文档表,它对我认为您的 eddsdbo.document 表所做的事情进行了采样:
declare @documents table (
docId int identity(1,1),
contents nvarchar(max)
);
insert @documents values
('The quick brown fox jumps over the lazy dog'),
('The slow green turtle crawls under the brown and yellow giraffe');
好的,首先您要将文档内容拆分为单个单词:
declare @splittedWords table (
docId int,
wordNum int,
word nvarchar(50)
);
with
splitWords as (
select docId,
contents,
start = charindex(' ', contents) + 1,
conLen = len(contents),
wordNum = 1
from @documents
union all
select docId,
ap.contents,
start = charindex(' ', ap.contents) + 1,
conLen = len(ap.contents),
wordNum = wordNum + 1
from splitWords
cross apply (select contents =
substring(contents, start, conLen - 1)
) ap
where start > 1
)
insert @splittedWords
select docId,
wordNum,
word = iif(
wordNum = max(wordNum) over(partition by docId),
contents,
substring(contents, 0, start - 1)
)
from splitWords;
现在,对于每个搜索词,您想要获取该词在内容中的位置,以及后面的词:
declare @filteredSplits table (
search nvarchar(50),
docId int,
wordNum int,
word nvarchar(50)
);
insert @filteredSplits
select search = finds.word,
w.docId,
w.wordNum,
w.word
from @searches s
join @splittedWords finds on s.termName = finds.word
join @splittedWords w
on finds.docId = w.docId
and w.wordNum between finds.wordNum and finds.wordNum + s.wordsAfter;
最后,连接:
select fs.search,
fs.docId,
extract = stuff((
select ' ' + sub.word
from @filteredSplits sub
where sub.docId = fs.docId
and sub.search = fs.search
order by sub.wordNum
for xml path('')
), 1, 1, '')
from @filteredSplits fs
group by fs.search, fs.docId
+-------------------------------------------+
| search | docId | extract |
+-------------------------------------------+
| brown | 1 | brown fox jumps over |
| brown | 2 | brown and yellow giraffe |
| green | 2 | green turtle crawls |
+-------------------------------------------+
关于从文本字段中提取单词的 SQL 查询,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/60103313/
在有些场景下,我们需要对我们的varchar类型的字段做修改,而修改的结果为两个字段的拼接或者一个字段+字符串的拼接。 如下所示,我们希望将xx_role表中的name修改为name+id。
SELECT incMonth as Month, SUM( IF(item_type IN('typ1', 'typ2') AND incMonth = Month, 1, 0 ) )AS
我最近读到 volatile 字段是线程安全的,因为 When we use volatile keyword with a variable, all the threads read its va
我在一些模型中添加了一个 UUID 字段,然后使用 South 进行了迁移。我创建的任何新对象都正确填充了 UUID 字段。但是,我所有旧数据的 UUID 字段为空。 有没有办法为现有数据填充 UUI
刚刚将我的网站从 mysql_ 更新为 mysqli,并破坏了之前正常运行的查询。 我试图从旋转中提取 id,因为它每次都会增加 1,但我不断获取玩家 id,有人可以告诉我我做错了什么吗?我尝试了将
我在 Mac OS X 上使用带有 Sequel Pro 的 MySQL。我想将一个表中的一个字段(即名为“GAME_DY”的列)复制到另一个名为“DAY_ID”的表的空字段中。两个表都是同一数据库的
问题: 是否有可能有一个字段被 JPA 保留但被序列化跳过? 可以实现相反的效果(JPA 跳过字段而序列化则不会),如果使用此功能,那么相反的操作肯定会很有用。 类似这样的事情: @Entity cl
假设我有一个名为“dp”的表 Year | Month | Payment| Payer_ID | Payment_Recipient | 2008/2009 | July
我将尝试通过我的 Raspberry Pi 接入点保证一些 QoS。 开始之前,我先动手:我阅读了有关 tcp、udp 和 ip header 的内容。在IP header description我看
如果你能弄清楚如何重命名这个问题,我愿意接受建议。 在 Dart 语言中,可以编写一个带有 final 字段的类。这些是只能设置的字段构造函数前 body 跑。这可以在声明中(通常用于类中的静态常量)
你怎么样? 我有两个带有两个字段的日期选择器 我希望当用户选择 (From) 时,第二个字段 (TO) 将是 next day 。比如 booking.com 例如:当用户选择From 01-01-2
我想我已经看到了这个问题的一些答案,这些答案可能与我需要的相差不远,但我对 mysql 的了解还不够确定,所以我会根据我的具体情况提出问题。 我有一个包含多个表的数据库,为此,如果“image”表上的
我在 mySQL 数据库中有 2 个表: customers ============ customer_id (1, 2 ) customer_name (john, mark) orders ==
我正在开发一个员工目标 Web 应用程序。 领导/经理在与团队成员讨论后为他们设定目标。这是一年/半年/季度,具体取决于组织遵循的评估周期。 现在的问题是添加基于时间段的字段或存档上一季度/年度数据的
我正在寻找允许内容编辑器从媒体库中选择多个文件的东西,这些文件将在渲染中列出。他们还需要能够上传文件和搜索。它必须在页面编辑器(版本 8 中称为体验编辑器)中工作。 到目前为止我所考虑的: 一堆文件字
现在,我有以下由 original.df %.% group_by(Category) %.% tally() %.% arrange(desc(n)) 创建的 data.frame。 DF 5),
我想知道是否有一些步骤/解决方案可以处理错误消息并将它们放入 Pentaho 工具中的某个字符串或字段中?例如,如果连接到数据库时发生某些错误,则将该消息从登录到字符串/字段。 最佳答案 我们在作业的
如何制作像短信应用程序一样的“收件人”字段?例如,右侧有一个“+”按钮,当添加某人时,名称将突出显示并可单击,如圆角矩形等。有没有内置的框架? 最佳答案 不,但请参阅 Three20 的 TTMess
是否可以获取记录的元素或字段的列表 通过类型信息类似于类的已发布属性的列表吗? 谢谢 ! 最佳答案 取决于您的delphi版本,如果您使用的是delphi 2010或更高版本,则可以使用“新rtti”
我正在构建一个 SQLite 数据库来保存我的房地产经纪人的列表。我已经能够使用外键来识别每个代理的列表,但我想在每个代理的记录中创建一个列表;从代理商和列表之间的一对一关系转变为一对多关系。 看这里
我是一名优秀的程序员,十分优秀!