mysql - 雪花图和多对多关系-6ren

mysql - 雪花图和多对多关系

转载作者：行者123 更新时间：2023-11-29 02:24:27

24

4

我有一个雪花图:

Fact: 
id_movie
id_user
rating

Dim Users:
id_user
...


Dim Movies:
id_movie
...

在我的 ERD 中，我还有一个表类别，它与这样的电影有多对多的关系:

Dim_Category:
id_category
...

Map_Category_Movie:
id_movie
id_category
relevance

我正在尝试找到一种有效的方法来在雪花/星型模式中对此进行建模。我的问题:

我可以将这两个表添加到雪花图中，但这样做会让人感觉不对，因为我通常只使用该图外围子表的聚合表。
我可以为相关性创建另一个事实表，但由于我想最终报告用户相关性与他们在电影评级中的行为之间的相关性，我需要同时使用这两个事实表，这对我来说是不正确的方法。

这里有什么指导吗？

最佳答案

很有可能您已经对自己做出了回答并欢迎来到 hell 。一、引自http://www.information-management.com/你会感兴趣:

The snowflake structure will reduce batch updates to dimensions. Though always said to be slower than a star, some tests have revealed no difference in performance between flattened and snowflaked dimensions. In fact in some cases, the snowflake provides superior performance, such as when a wide dimension (i.e., customer) is segmented into a snowflake.

因此，使用桥接表不会导致性能显着下降。在大多数情况下，我更喜欢雪花，因为有时管理数据集市真的更容易，而且硬件/数据大小为您提供了这样做的机会。

我的友好建议是创建桥接表(movie_ID、category_ID、relevance)并继续。

如果您有固定和小的类别列表，请创建包含预定义类别的表:

dim_movies
----------
movies_id
category1_relavance
category2_relavance
category3_relavance

最多 10 个也许没问题，尤其是如果您为创建 dwh 的公司工作，而不仅仅是咨询它(您可以管理)。

曾经，我们试图创建数据仓库的杰作，其中有一个与您类似的示例。付款交易基于性能(每个事实表的数据超过 2TB)，因此我们决定尝试创建星型模式。

我们像上面描述的那样创建了维度，每次都没有。不同类别的增长 etl 在表中添加了新字段。ETL 过程还必须动态地重新创建多维数据集。这需要很多痛苦，但我记得性能比雪花好 13%。

此外，在最详尽的项目中，我相信 10 岁的 child 会更好地设计 DB，我们必须准确地将每个项目连接 5 个类别。每个类别指向 20 多个可能的表格之一。它只能根据某些规则通过他们的软件加入。这是某种 1...5:许多关系(它不存在!？!)

pk     code_conto     cat1    cat2    cat3    cat4    cat5
----------------------------------------------------------
1      123            17      NULL    5467    12      NULL
2      124            67      1098    NULL    1423    AK12
3      123            NULL    NULL    NULL    13      23

代码是这样的:

If (code_conto == 123)
{
    Category1_join_set = 'SELECT cat_id, cat_name FROM cat_customers'; //NOTE THIS
    Category2_join_set = 'SELECT cat_id, cat_name FROM cat_products';
    Category3_join_set = 'SELECT cat_id, cat_name FROM cat_city';
    ...
    ...
}
    If (code_conto == 124)
{
    Category1_join_set = 'SELECT cat_id, cat_name FROM cat_products'; //AND THIS
    Category2_join_set = 'SELECT cat_id, cat_name FROM cat_origin';   //ON SAME FIELD
    Category3_join_set = 'SELECT cat_id, cat_name FROM cat_blabla';   //DIFFERENT JOIN TABLE
    ...
    ...
}

全部硬编码。所以我们硬编码我们的查询，在 CASE 语句中重复 WHEN 超过 100 次。你猜怎么了？ ERP 提供商“改进”了他的软件并创建了映射表，其中“C”是基于 code_conto 键的语句。我们花了 3 个多星期的时间来提供良好且安全的 ETL 作业(使用 SQL、外部工具)。

我不是白写了这一切。我想说服您和其他人，在多对多关系中使用桥接表可能是 97% 的最佳实践。

但是，有五种可能的 M:M 关系设计解决方案:

数组或系列(我什至不想尝试)
桥牌
分组
固定水平
动态创建的固定关卡

希望我没有让您感到困惑。

关于mysql - 雪花图和多对多关系，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/25344169/

24

4

0

文章推荐： ios - 辅助 NSThread 中的 NSTimer 不起作用

文章推荐： php - 如何从连接表结果中具有相同名称的两个值中获取单个值？

文章推荐： android - Xamarin 动态形成 Tabbar 加载页面

文章推荐： MySQL 出错。错误 : ER_DUP_FIELDNAME: Duplicate column

Matlab 填充 contour3 图，如 contourf 图
我想填充 3D 等高线图 (contour3(X,Y,Z))，就像 2D 等高线填充图 (contourf(X,Y,Z))。但我无法弄清楚如何实现这一目标。 contour3 和 surf 的组合不是
javascript - c3.js - 带有工具提示的 c3 图，里面有 c3 图
我有一个 c3.js 折线图，表示 2 个值的演变。我需要折线图的工具提示是饼图(工具提示 = 另一个 c3.js 图形)。这是我成功的: http://jsfiddle.net/owhxgaqm/
pandas - 来自 Pandas Dataframe 的 Seaborn fiddle 图，每列都有自己单独的 fiddle 图
我有具有结构的 Pandas 数据框: A B 0 1 1 1 2 1 2 3 4 3 3 7 4 6 8 如何生成 Seaborn Violin 图，每列作为其自己的单独
c++ - 基于 2D 图 block 的游戏，当我用相机放大时，图 block Sprite 之间会出现间隙吗？
我正在使用 D3DXSPRITE 方法将我的 map 图 block 绘制到屏幕上，我刚刚添加了一个缩放功能，当您按住向上箭头时会放大，但注意到您现在可以看到图 block 之间的间隙，这是一些屏幕截
数据结构-图
今天我们开始学习目前学习到的最难最复杂的数据结构图。简单回顾一下之前学习的数据结构，数组、单链表、队列等线性表中数据元素是一对一关系，而树结构中数据元素是一对多关系，而图结构中数据元素则是多对
linux服务器磁盘扩容的方法(图)
1、系统环境如下图： 2、为该系统添加一块新的虚拟硬盘，添加后需重启虚拟机，否则系统不识别；如下图，/dev/sdc 是新添加的硬盘； 3、fdisk /dev/sdc为新硬盘创建分区：
基于Linux下Nagios的安装与配置说明介绍[图]
1、nagios简介　　nagios是一款开源的电脑系统和网络监视工具，能有效监控windows、linux和unix的主机状态，交换机路由器等网络设置，打印机等。在系统或服务状态异常时发
从亚马逊的7个例子中学会如何成功做好邮件营销(图)
越来越多人开始习惯用手机上网，浏览网页、查看邮件···移动化已经成为互联网发展必然趋势，包括facebook在内的很多互联网公司都将移动广告作为下一个淘金地
Android图片处理实例介绍(图)
1.图片处理 1.圆角图片复制代码代码如下: /** * 转换成圆角 * &n
sqlserver数据库导入数据操作详解(图)
Microsoft SQL Server Management Studio是SQL SERVER的客户端工具，相信大家都知道。我不知道大伙使用导入数据的情况怎么样，反正我最近是遇到过。主要是因为没
debian6配置mysql允许远程连接的方法(图)
debian6系统：首先先安装mysql吧：打开终端（root）用户登入 apt-get purge mysql-server-5.5 安装完成后：默认情况下Mysql只允许本地登录
fedora16英文环境下支持中文输入法的方法介绍(图)
fedora16英文环境下支持中文输入法的方法 fedora16英文环境下支持FCITX的中文输入法： $ im-chooser 就会出现选择界面，选择第二个就行了。
.net预编译命令详解(图)
Net预编译命令 C:\WINDOWS\Microsoft.NET\Framework\v2.0.50727\aspnet_compiler.exe -? 显示说明我们需要选择的命令为&n
主板BIOS恢复出厂设置的方法[图]
有的时候电脑出现一些故障有的时候通过将其修改bios设置的方法来解决故障，那么在bios上设置能不能将电脑恢复出厂设置呢?其实也是可以的。方法也很简单的，只要会进入电脑的bios懂的上面英文的意思就
[图]Deepin系统首次在龙芯3号电脑上运行成功
笔者曾介绍过Deepin 将对龙芯进行全面支持，打造最优美龙芯电脑桌面。现在Deepin团队移植工作取得了突破性的成果，Deepin桌面已经在龙芯3A和龙芯3B电脑上成功运行起来了。以下为龙芯3
通过锁定Win7注册表编辑器来防止主页被篡改的方法(图)
在安装一些软件之后，我们的电脑总是会发生一点小变化，不是桌面上多了几个网址图标，就是IE浏览器的默认主页被篡改成乱七八糟的网址。最可气的是，在IE设置中将默认主页改回来后，下次启动Win7后又变了回
常用的注册表编辑器打开的方法汇总(图)
“注册表编辑器怎么打开”虽说不是很难的问题，但是对于对电脑常识不是很擅长的网民来说，当电脑出现问题或需要更改设置时，着实还是件头疼的问题。因为需要打开注册表进行操作解决。那么如何打开注册表编辑器呢?
WordPress建站的10个重要的安全插件和技巧(图)
这篇文章重点介绍10个重要的WordPress安全插件和技巧，用来保护WordPress网站或者博客。 1. WP Security 人工帮助你修复被黑客入侵的网站，只要按照他们网站上的联系电话
实现dedecms友情链接分栏目调用的方法(图)
其实运用object和javascript调用外部文件，也能实现不同栏目调用不同友情链接，即相当于调用不同栏目友情链接文件， {dede:field.typeid/}来获取当前栏目的ID。
复数矩阵的 R 图
我有一个复值矩阵。如果我发出命令: plot(myMatrix) 然后它在图形设备上显示一种散点图，X 轴标记为 Re(myMatrix)，Y 轴标记为 Im(myMatrix)。这显示了我正在寻找

首页

博学

6Ren·AI

商城

mysql - 雪花图和多对多关系