- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我有一些软件可以在很长一段时间内收集数据,每秒大约 200 个读数。为此,它使用 SQL 数据库。我希望使用 Azure 将大量旧的“存档”数据移动到。
该软件使用 Multi-Tenancy 类型架构,因此我计划每个租户使用一个 Azure 表。每个租户可能正在监视 10-20 个不同的指标,因此我计划使用指标 ID (int) 作为分区键。
由于每个指标每分钟只有一次读数(最大值),因此我计划使用 DateTime.Ticks.ToString("d19") 作为我的 RowKey。
但是,我对如何扩展缺乏一点了解;所以希望有人能够解决这个问题:
为了提高性能,Azure 将/可能会按分区键拆分我的表,以便让事情保持良好和快速。在这种情况下,这将导致每个指标一个分区。
但是,我的行键可能代表大约 5 年的数据,因此我估计大约 250 万行。
Azure 是否足够聪明,可以根据行键进行拆分,还是我在设计 future 的瓶颈?我知道通常不要过早优化,但使用像 Azure 这样的东西似乎并不像平常那样明智!
正在寻找 Azure 专家,让我知道我的想法是否正确,或者我是否应该将数据分区到更多表中。
最佳答案
一些评论:
除了存储数据之外,您可能还想了解如何检索数据,因为这可能会极大地改变您的设计。您可能想问自己一些问题:
(DateTime.MaxValue.Ticks - DateTime.UtcNow.Ticks).ToString("d19")
。此外,由于 PartitionKey 是一个字符串值,您可能需要将 int
值转换为带有一些“0”预填充的 string
值,以便所有 id 按顺序显示否则你会得到 1, 10, 11, .., 19, 2, ...等等。
据我所知,Windows Azure 仅基于 PartitionKey
而不是 RowKey
对数据进行分区。在分区内,RowKey
用作唯一键。 Windows Azure 将尝试将具有相同 PartitionKey 的数据保留在同一节点中,但由于每个节点都是物理设备(因此具有大小限制),因此数据也可能流向另一个节点。
您可能想阅读 Windows Azure 存储团队的这篇博客文章:http://blogs.msdn.com/b/windowsazurestorage/archive/2010/11/06/how-to-get-most-out-of-windows-azure-tables.aspx .
更新根据您下面的评论和上面的一些信息,让我们尝试做一些数学计算。这是基于此处发布的最新可扩展性目标:http://blogs.msdn.com/b/windowsazurestorage/archive/2012/11/04/windows-azure-s-flat-network-storage-and-2012-scalability-targets.aspx 。该文档指出:
Single Table Partition– a table partition are all of the entities in a table with the same partition key value, and usually tables have many partitions. The throughput target for a single table partition is:
- Up to 2,000 entities per second
- Note, this is for a single partition, and not a single table. Therefore, a table with good partitioning, can process up to the 20,000 entities/second, which is the overall account target described above.
现在您提到您有 10 - 20 个不同的指标点,对于每个指标点,您每分钟最多写入 1 条记录,这意味着您每分钟/表最多写入 20 个实体,即远低于每秒 2000 个实体的可扩展性目标。
现在的问题仍然是阅读。假设用户最多可以读取每个分区 24 小时的数据(即 24 * 60 = 1440 点)。现在假设用户获取 1 天的所有 20 个指标的数据,则每个用户(因此每个表)最多将获取 28,800 个数据点。我想留给您的问题是每秒可以收到多少个这样的请求才能满足该阈值。如果您能够以某种方式推断此信息,我认为您可以得出有关架构的可扩展性的一些结论。
我还建议您观看此视频:http://channel9.msdn.com/Events/Build/2012/4-004 .
希望这有帮助。
关于azure - Azure表存储分区设计,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/15809078/
我正在运行一个辅助角色,并检查 Azure 上托管的存储中是否存在数据。当我将连接字符串用于经典类型的存储时,我的代码可以正常工作,但是当我连接到 V2 Azure 存储时,它会抛出此异常。 “远程服
在我的应用程序的主页上,我正在进行 AJAX 调用以获取应用程序各个部分所需的大量数据。该调用如下所示: var url = "/Taxonomy/GetTaxonomyList/" $.getJSO
大家好,我正在尝试将我的商店导入我的 Vuex Route-Gard。 路由器/auth-guard.js import {store} from '../store' export default
我正在使用 C# 控制台应用程序 (.NET Core 3.1) 从 Azure Blob 存储读取大量图像文件并生成这些图像的缩略图。新图像将保存回 Azure,并将 Blob ID 存储在我们的数
我想将 Mlflow 设置为具有以下组件: 后端存储(本地):在本地使用 SQLite 数据库存储 Mlflow 实体(run_id、params、metrics...) 工件存储(远程):使用 Az
我正在使用 C# 控制台应用程序 (.NET Core 3.1) 从 Azure Blob 存储读取大量图像文件并生成这些图像的缩略图。新图像将保存回 Azure,并将 Blob ID 存储在我们的数
我想将 Mlflow 设置为具有以下组件: 后端存储(本地):在本地使用 SQLite 数据库存储 Mlflow 实体(run_id、params、metrics...) 工件存储(远程):使用 Az
我的 Windows 计算机上的本地文件夹中有一些图像。我想将所有图像上传到同一容器中的同一 blob。 我知道如何使用 Azure Storage SDKs 上传单个文件BlockBlobServi
我尝试发出 GET 请求来获取我的 Azure Blob 存储帐户的帐户详细信息,但每次都显示身份验证失败。谁能判断形成的 header 或签名字符串是否正确或是否存在其他问题? 代码如下: cons
这是用于编写 JSON 的 NeutralinoJS 存储 API。是否可以更新 JSON 文件(推送数据),而不仅仅是用新的 JS 对象覆盖数据。怎么做到的??? // Javascript
我有一个并行阶段设置,想知道是否可以在嵌套阶段之前运行脚本,所以像这样: stage('E2E-PR-CYPRESS') { when { allOf {
我想从命令行而不是从GUI列出VirtualBox VM的详细信息。我对存储细节特别感兴趣。 当我在GUI中单击VM时,可以看到包括存储部分在内的详细信息: 但是到目前为止,我还没有找到通过命令行执行
我有大约 3500 个防洪设施,我想将它们表示为一个网络来确定流动路径(本质上是一个有向图)。我目前正在使用 SqlServer 和 CTE 来递归检查所有节点及其上游组件,只要上游路径没有 fork
谁能告诉我 jquery data() 在哪里存储数据以及何时删除以及如何删除? 如果我用它来存储ajax调用结果,会有性能问题吗? 例如: $("body").data("test", { myDa
有人可以建议如何为 Firebase 存储中的文件设置备份。我能够备份数据库,但不确定如何为 firebase 存储中的文件(我有图像)设置定期备份。 最佳答案 如何进行 Firebase 存储的本地
我最近开始使用 firebase 存储和 firebase 功能。现在我一直在开发从功能到存储的文件上传。 我已经让它工作了(上传完成并且文件出现在存储部分),但是,图像永远保持这样(永远在右侧加载)
我想只允许用户将文件上传到他们自己的存储桶中,最大文件大小为 1MB,仍然允许他们删除文件。我添加了以下内容: match /myusers/{userId}/{allPaths=**} { al
使用生命周期管理策略将容器的内容从冷访问层移动到存档。我正在尝试以下策略,希望它能在一天后将该容器中的所有文件移动到存档层,但事实并非如此在职的。我设置了选择标准“一天未使用后”。 这是 json 代
对于连接到 Azure 存储端点,有 http 和 https 两个选项。 第一。 https 会带来开销,可能是 5%-10%,但我不支付同一个数据中心的费用。 第二。 http 更快,但 Auth
有人可以帮我理解这一点吗?我创建了Virtual Machine in Azure running Windows Server 2012 。我注意到 Azure 自动创建了一个存储帐户。当我进入该存
我是一名优秀的程序员,十分优秀!