- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我有一个数据流任务,其中包含如下所示的信息:
Province | City | Population
-------------------------------
Ontario | Toronto | 7000000
Ontario | London | 300000
Quebec | Quebec | 300000
Quebec | Montreal| 6000000
Province | City | Population
-------------------------------
Ontario | Toronto | 7000000
Quebec | Montreal| 6000000
最佳答案
完全同意@PaulStock 的观点,聚合最好留给源系统。 SSIS 中的聚合是一个完全阻塞的组件,很像排序,我有 already made my argument on that point .
但是有时在源系统中执行这些操作是行不通的。我能想到的最好的办法是基本上对数据进行双重处理。是的,ick,但我从来没有找到一种方法来不受影响地通过一个列。对于最小/最大场景,我希望将其作为一个选项,但显然像 Sum 这样的东西会使组件难以知道它所关联的“源”行是什么。
2005年
2005 年的实现看起来像这样。您的性能不会很好,实际上与良好的性能相差几个数量级,因为除了必须重新处理源数据之外,您还将在其中进行所有这些阻塞转换。
合并连接
2008年
2008 年,您可以选择使用 Cache Connection Manager这将有助于消除阻塞转换,至少在重要的地方,但您仍然需要支付双重处理源数据的成本。
将两个数据流拖到 Canvas 上。第一个将填充缓存连接管理器,并且应该是聚合发生的地方。
现在缓存中有聚合数据,在主数据流中删除查找任务并对缓存执行查找。
常规查找选项卡
选择缓存连接管理器
映射适当的列
巨大的成功
脚本任务
我能想到的第三种方法,2005 年或 2008 年,是自己编写。作为一般规则,我尽量避免脚本任务,但在这种情况下它可能是有意义的。您需要将其设为 asynchronous script transformation但只需在那里处理您的聚合。更多的代码需要维护,但您可以省去重新处理源数据的麻烦。
最后,作为一般警告,我会调查关系会对您的解决方案产生什么影响。对于这个数据集,我预计像圭尔夫这样的东西会突然膨胀并与多伦多联系在一起,但如果确实如此,包裹应该怎么做?现在,两者都会导致安大略省 2 行,但这是预期的行为吗?当然,脚本允许您定义在平局的情况下会发生什么。您可能可以通过缓存“正常”数据并将其用作查找条件并使用聚合来撤回其中一个关系,从而使 2008 年的解决方案完全站稳脚跟。 2005 可能只是通过将聚合作为合并连接的左源来做同样的事情
编辑
Jason Horner 在他的评论中有一个好主意。另一种方法是使用多播转换并在一个流中执行聚合并将其重新组合在一起。我不知道如何让它与联合一起工作,但我们可以像上面那样使用排序和合并连接。这可能是一种更好的方法,因为它为我们省去了重新处理源数据的麻烦。
关于sql-server - 使用 SSIS,我如何找到人口最多的城市?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/8080979/
本周我将在 Windows Server 2008 上设置一个专用的 SQL Server 2005 机器,并希望将其精简为尽可能简单,同时仍能发挥全部功能。 为此,“服务器核心”选项听起来很有吸引力
已关闭。此问题不符合Stack Overflow guidelines 。目前不接受答案。 这个问题似乎与 help center 中定义的范围内的编程无关。 . 已关闭 8 年前。 Improve
我获取了 2014 版本数据库的备份,并尝试在另一台服务器中将其恢复到具有相同名称和登录名的数据库中。此 SQL Server 版本是 2016。 恢复备份文件时,出现此错误: TITLE: Micr
我获取了 2014 版本数据库的备份,并尝试在另一台服务器中将其恢复到具有相同名称和登录名的数据库中。此 SQL Server 版本是 2016。 恢复备份文件时,出现此错误: TITLE: Micr
TFS 是否提供任何增强的方法来存储对 sql server 数据库所做的更改,而不是使用它来对在数据库上执行的 sql 语句的文本文件进行版本控制? 或者我正在寻找的功能是否仅在第 3 方工具(如
关闭。这个问题需要多问focused 。目前不接受答案。 想要改进此问题吗?更新问题,使其仅关注一个问题 editing this post . 已关闭 9 年前。 Improve this ques
我即将将我的 SQL Server 2012 实例升级到 SQL Server 2014。 我已经克隆了主机 Windows VM 并将其重命名为 foo-2012至 foo-2014 . 重新启动时
我想为 SQL Server 登录授予对数据库的访问权限。我知道 sp_grantdbaccess,但它已被弃用。我可以改用什么以及如何检查登录名是否还没有访问数据库的权限? 场景:UserA 创建数
客户别无选择,只能在接下来的几天内从 sql server 2000 迁移到 2008。测试显示 2005 年的重要功能出现了 Not Acceptable 性能下降,但 2008 年却没有。好消息是
我有一个测试数据库,我需要将其导出到我们客户的测试环境中。 这将是一次性的工作。 我正在使用 SQL Server 2005(我的测试数据库是 SQL Server 2005 Express) 执行此
我需要将一个 CSV 文件导入到 mongoDB 不幸的是我遇到了以下错误: error connecting to host: could not connect to server: se
我以为 R2 是一个补丁/服务包。我一直在寻找下载,但没有看到。因此,我假设 R2 是一个新版本,并且我需要 sqlserver 2008 r2 的安装介质来进行升级? 另外,我需要为新许可证付费吗?
我无法使用 SQL Server Management Studio 连接到 SQL Server。 我有一个连接字符串: 我尝试通过在服务器名中输入 myIP、在登录名中输入 MyID、在密码中
我们希望使用 SQL Server 加密来加密数据库中的几个列。我们还需要在生产和测试环境之间传输数据。看来最好的解决方案是在生产和测试服务器上使用相同的主 key 、证书和对称 key ,以便我可以
有没有可以分析 SQL Server 数据库潜在问题的工具? 例如: a foreign key column that is not indexed 没有 FILL FACTOR 的 uniquei
我正在尝试从我的 SQL 2012 BI 版本建立复制,但我收到一条奇怪的错误消息! "You cannot create a publication from server 'X' because
如果您使用 SQL Server 身份验证 (2005),登录详细信息是否以明文形式通过网络发送? 最佳答案 如您所愿,安全无忧... 您可以相当轻松地配置 SSL,如果您没有受信任的证书,如果您强制
我想将数据从一个表复制到不同服务器之间的另一个表。 如果是在同一服务器和不同的数据库中,我使用了以下 SELECT * INTO DB1..TBL1 FROM DB2..TBL1 (to copy w
我希望得到一些帮助,因为我在这个问题上已经被困了 2 天了! 场景:我可以从我的开发计算机(和其他同事)连接到 SERVER\INSTANCE,但无法从另一个 SQL Server 连接。我得到的错误
我正在尝试从我的 SQL 2012 BI 版本建立复制,但我收到一条奇怪的错误消息! "You cannot create a publication from server 'X' because
我是一名优秀的程序员,十分优秀!