- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我正在规划一个数据库驱动的网站,根据用户回答问题的方式来匹配用户。我认为最好的方法是在 SELECT 查询中运行匹配计算,但我不知道如何编写查询。
假设我有一个名为 user_answer 的表,它看起来像这样:
+--------+-------------+--------+------------------+--------+
| userid | question_id | answer | preferred_answer | weight |
+--------+-------------+--------+------------------+--------+
| 1 | 20 | 3 | | 0 |
| 1 | 24 | 3 | 2, 3 | 1 |
| 1 | 36 | 2 | 2 | 10 |
| 1 | 37 | 3 | 1, 2, 3 | 50 |
| 1 | 40 | 3 | 3 | 250 |
| 2 | 20 | 3 | 3 | 10 |
| 2 | 24 | 3 | 2 | 1 |
| 2 | 25 | 2 | | 0 |
| 2 | 26 | 2 | | 0 |
| 2 | 40 | 3 | 2 | 250 |
+--------+-------------+--------+------------------+--------+
我想按match_percentage进行选择和排序 - match_percentage 应按以下方式计算:
我不知道这是否可能。我预计数据库会变得非常大,因此加载所有数据库并在 PHP 中进行计算可能不是最佳选择 - 但如果我错了,请纠正我。
是否可以在查询中进行所有这些计算?
最佳答案
是的,我相信所有指定的计算都可以在查询中执行。
假设 (userid, Questionid) 是唯一的,我们首先查找具有“匹配”问题的 userid。我们可以通过这样的查询来做到这一点:
SELECT u.answer
, u.preferred_answer
, u.weight
, m.userid AS m_userid
, m.question_id AS m_question_id
, m.answer AS m_answer
, m.preferred_answer AS m_preferred_answer
, m.weight AS m_weight
FROM user_answer u
JOIN user_answer m
ON m.question_id = u.question_id
AND m.userid <> u.userid
AND u.userid = 1
ORDER
BY m.userid
, m.question_id
一旦我们完成了这项工作,我们就可以努力获取总权重并从中进行计算。
假设 preferred_answer
列是 VARCHAR 类型,并且包含逗号分隔的元素列表,没有空格,例如'2'
或 '2,3,5'
,您可以使用 MySQL FIND_IN_SET
函数返回特定元素的索引位置列表内。如果未找到“匹配”,则返回 0。
我相信此查询符合规范。
SELECT m.userid AS m_userid
, SUM(u.weight) AS total_weight1
, SUM(IF(FIND_IN_SET(m.answer,u.preferred_answer),u.weight,0)) AS match1_weight
, SUM(m.weight) AS total_weight2
, SUM(IF(FIND_IN_SET(u.answer,m.preferred_answer),m.weight,0)) AS match2_weight
, SQRT(
( SUM(IF(FIND_IN_SET(m.answer,u.preferred_answer),u.weight,0)) / SUM(u.weight) )
* ( SUM(IF(FIND_IN_SET(u.answer,m.preferred_answer),m.weight,0)) / SUM(m.weight) )
) AS match_percentage
FROM user_answer u
JOIN user_answer m
ON m.question_id = u.question_id
AND m.userid <> u.userid
AND u.userid = 1
GROUP
BY m.userid
ORDER
BY match_percentage DESC
注意:
这些查询仅经过桌面检查。我没有设置 SQL Fiddle 来测试。
第 4 项似乎是当前用户权重的总和,但仅包含匹配答案。如果没有匹配答案,我们将返回 0。与第 6 项相同,但只是相反。)
如果用户 ID 1 和其他用户 ID 之间没有匹配问题,则不会为其他用户 ID 返回任何行。
对于大型设备,这可能会持续一段时间。合适的覆盖索引应该可以提高性能。
为了提高查询性能,您可能需要考虑将此查询的结果“缓存”到单独的表中。仅当原始表中的行被插入、更新、删除时,才需要刷新“缓存”表的内容。并且之前计算的结果对于正常访问来说可能仍然“足够好”。
如果您存储了结果,您还希望将 u.userid
作为 SELECT 列表和 GROUP BY 中的列返回。
关于php - 这个复杂的查询可以在 MySQL 中实现吗?还是我需要 PHP?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/24399035/
我之前发布过question已得到答复,但我也需要对此进行查询。我有一个包含这样数据的表结构(日期格式为 dd/mm/yyyy)。 ID Account Number Unit Ad
我正在使用 React Native Calendars 并尝试为议程组件构建我的数据。 预期的数据结构是(一个对象) { '2012-05-22': [{text: 'item 1 - any j
这个问题不太可能对任何 future 的访客有帮助;它只与一个较小的地理区域、一个特定的时间点或一个非常狭窄的情况相关,通常不适用于全世界的互联网受众。如需帮助使此问题更广泛适用,visit the
两列城镇和优先级。 我需要对表进行排序,以便优先级=1的城镇排在第一位,并且不按名称 ASC 排序,而其余城镇则按名称 ASC 排序。 我该怎么做? 谢谢;) 更新 SELECT * FROM map
我有三个表“Hardware_model”、“Warehouse”和“Brand”,并且表以这种方式一起引用:Hardware_model 仓库Hardware_model 品牌 现在我要执行以下
我有一个 MySQL 表 (tbl_filters),包含 3 列:id、cat、val id 和 val 是数字,cat 是 varchar。每个 id 有多行。 我还有另一个包含多个列的表 (tb
我想获取字段的不同值,比方说:field1...这需要一个如下查询:“从表中选择不同的(字段1)” 但是,对于某些记录,field1 为空,并且还有另一列可以替代 field1,即 field2。对于
表 1 - 用户 id username items 1 Paul 1(0020);2(0001); 表 2 - 项目 id name 1 name_here 在我的用户的项目中,我输入了 2(000
我想连接同一个表 4 次以获取列的显示方式,我不确定是否可以在 1 个 SQL 语句中完成。 tbl_用户名 id username 1 Adam 2 Bob 3 Chris tbl_机
首先,我刚刚开始自己学习JS,没有任何编程经验,这意味着我仍然要了解这种出色的编程语言的基本构建模块。 我的问题与我编写的以下代码有关: let orderCount = 0; con
关闭。这个问题需要details or clarity .它目前不接受答案。 想改进这个问题吗? 通过 editing this post 添加细节并澄清问题. 关闭 9 年前。 Improve t
我正在使用 XMAPP,MySQL 正在正常运行。在 phpMyAdmin 中,我不太明白这一点,所以我尝试在 PHP 中创建一个。使用此代码,它会告诉我数据库 benutzer。尽管我在 phpMy
是否有一种高效的算法可以找到平均度最大的子图(可能是图本身)? 最佳答案 The paper "Finding a Maximum-Density Subgraph" by Andrew Goldbe
目录 1、业务背景 2、场景分析 3、流程设计 1、业务流程 2、导入流程
我有 2 个表: 1) 包含自 1900 年 1 月 1 日以来所有日期的 Masterdates 表 2) Stockdata 表,其中包含表单中的股票数据 日期、交易品种、开盘价、最高价、最低价、
我有一个非常复杂的 UI,其状态栏不断变化,其中包含多种类型的状态消息,并且 UI 具有复杂的图表控件和已加载的指示性地理 map 。 现在这些小而复杂的区域的数据上下文具有同样复杂的 ViewMod
有人可以用简单的方式向我解释为什么常量在大 O 表示法中无关紧要吗?为什么添加常量时复杂性保持不变。这不是作业问题,我只是想更好地理解这一点。让我明白这个大 O 是为了看到一个函数在接近无穷大时的行为
我在 flex 搜索索引中有以下文档。 [{ "_index": "ten2", "_type": "documents", "_id": "c323c
我有一个以零碎的方式构建的 LINQ 查询,如下所示: var initialQuery = from item in MyContext where xxx == yyy select item;
我目前正在涉足 SQL,并且希望针对我所创建的问题获得一些帮助。 为了练习一些编程,我正在制作一个 IOU 应用程序。下面是我存储的表我的借条记录(忽略一些相关栏目)。该表允许用户说“嘿,你欠我 X
我是一名优秀的程序员,十分优秀!