- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我希望将 Azure 数据 block 连接到事件中心并通过 splunk 读取它。最初,我能够发送测试消息,并能够在 splunk 中接收事件(可以按照 https://learn.microsoft.com/en-us/azure/databricks/scenarios/databricks-stream-from-eventhubs 使用 scala --> 将推文发送到事件中心)。现在我尝试使用 https://learn.microsoft.com/en-us/azure/event-hubs/event-hubs-python-get-started-send 中的引用文献使用 python 来实现相同的功能---> 发送事件。当我尝试传递对象参数时,它会抛出错误,例如无法从 Azure 事件中心导入
任何人都可以帮助我了解如何将 Azure databricks 与 Azure Eventhub 连接并包括发送对象参数吗?
PS:我已经添加了集群所需的必要库,如下所示:
我也用不同版本的库检查过它。
有人可以帮我解决如何以键值对格式传递对象参数的语法部分吗?
最佳答案
从 Azure Databricks 连接到 EventHub 非常简单 - 只需遵循官方文档,特别是 Writing Data to Event Hubs 部分即可。 (示例为批量写入):
writeConnectionString = "SharedAccessSignatureFromAzurePortal"
ehWriteConf = {
'eventhubs.connectionString' :
sc._jvm.org.apache.spark.eventhubs.EventHubsUtils.encrypt(writeConnectionString)
}
# Write body data from a DataFrame to EventHubs.
# Events are distributed across partitions using round-robin model.
ds = df \
.select("body") \
.write \
.format("eventhubs") \
.options(**ehWriteConf) \
.save()
您需要以某种方式构建 body
列 - 通过使用 to_json(struct("*"))
将数据编码为 JSON,或将数据编码为 Avro。 ..
但是您的集群配置也存在问题 - 特别是这两个库:azure-eventhubs-spark_2.11
和 com.microsoft.azure:azure-eventhubs-spark_2.11 :2.3.22
- 它们适用于 Spark 2,但您使用 Spark 3。卸载它们,然后重新启动集群。
关于azure - 尝试将 Azure Databricks 与 Azure 事件中心连接,以将一些属性发送到事件中心并通过 splunk 读取它,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/73291715/
我已经开始阅读 Databricks 推出的 Unity Catalog。我了解它试图解决的基本问题,但我不了解目录到底是什么。 这在 Databricks 文档中可用, A catalog cont
我正在努力了解 Databricks。 我发现文档逐步从 S3 或 Azure Datalake 导入数据,然后输出到 Azure Synapse Analytics 或其他数据仓库解决方案。 快速播
我想以编程方式将(Python Wheel)库添加到 /Shared Databricks 上的工作区。在 GUI(工作区 > 导入 > 库)中很容易做到,但我无法弄清楚如何在 Databricks
我正在创建一个带有公司 Logo 的 databricks 笔记本模板。使用以下代码显示图像会引发错误。 代码: %md 错误: HTTP ERROR 403: Invalid or missing
我将使用这张图片来形象化我的问题: Databricks1 在 Databricks 中创建数据库(和表)并将其数据存储在存储帐户中。在Databricks2中我想读取数据:Databricks2只有
有没有办法通过 python 笔记本确定现有的 Azure Databricks Secret Scope 是否由 Key Vault 或 Databricks 支持? dbutils.secrets
我正在尝试连接到 Databricks 上的 Spark 集群,并且正在学习本教程:https://docs.databricks.com/dev-tools/dbt.html .我安装了 dbt-d
我们可以使用Autoloader跟踪是否已从 S3 存储桶加载的文件。我关于 Autoloader 的问题:有没有办法读取 Autoloader 数据库以获取已加载文件的列表? 我可以在 AWS Gl
我们可以使用一些帮助来了解如何将 Spark Driver 和 worker 日志发送到 Azure Databricks 之外的目的地,例如Azure Blob 存储或使用 Eleastic-bea
将我的 Azure Databricks 从标准升级到主要,尝试开始使用 Databricks Delta: create table t using delta as select * from t
现在,databricks 自动加载器需要一个目录路径,从中加载所有文件。但是,如果其他类型的日志文件也开始进入该目录 - 有没有办法让 Autoloader 在准备数据帧时排除这些文件? df =
有人可以让我知道如何使用 databricks dbutils 从文件夹中删除所有文件。 我尝试了以下但不幸的是,Databricks 不支持通配符。 dbutils.fs.rm('adl://azu
我是 azure 的新手和databricks ,我学会了如何安装 blob 和利用,但我有一些疑问,而且我还没有找到任何文档的任何答案。所以请帮我解释一下: dbutils.fs.mount(
尝试遍历已安装的 Databricks 卷中的目录时遇到 ClassCastException。 java.lang.ClassCastException: com.databricks.backen
尝试遍历已安装的 Databricks 卷中的目录时遇到 ClassCastException。 java.lang.ClassCastException: com.databricks.backen
我正在运行 Databricks Community Edition,我想从以下 mnt 目录中删除文件 /mnt/driver-daemon/jars 我运行 dbutils 命令: dbutils
我已经在我的机器上创建了“.netrc”文件并尝试在 databricks rest api 调用下面。但它总是给出未经授权的错误。如何在 Databricks 中创建 .netrc 文件? curl
没有意识到 shift+enter 运行一个单元格。我正在写一个 delete from table 并按下 shift enter 删除了表中的所有数据。 最佳答案 在 Delta Lake 表中,
我需要访问 Azure Files来自 Azure Databricks .根据文档 Azure Blobs受支持,但我需要此代码来处理 Azure 文件: dbutils.fs.mount( s
我正在尝试使用服务主体从 Databricks 连接到 Synapse。 我已经在集群配置中配置了服务主体 fs.azure.account.auth.type..dfs.core.windows.n
我是一名优秀的程序员,十分优秀!