python - 使用来自非 python 的 pickle 二进制格式(使用 celery 和 rabbitmq)-6ren

python - 使用来自非 python 的 pickle 二进制格式(使用 celery 和 rabbitmq)

转载作者：太空狗更新时间：2023-10-30 00:57:02

24

4

我正在使用 Python、Celery 和 RabbitMQ 从松散耦合的系统中生成消息。但是，我担心互操作性。

当直接从 Celery 生成的 RabbitMQ 检查消息负载时，我得到以下二进制格式:

Binary version of celery output

我强烈怀疑这是二进制 pickle 格式。但是，我在查找有关二进制 pickle 格式的一般信息时遇到了麻烦。

所以，我真的有几个问题:

这是二进制 pickle 格式吗？
有哪些资源可用于映射二进制格式？
鉴于 celery 实际上会生成 pickle 数据，如果我想使用来自非 python 使用者(例如 c++ 或 php)的消息，我可以使用哪些选项？
您是否有使用 Celery、RabbitMQ 以及与非 Python 的其他消费者进行互操作的经验？你对这个问题有什么建议吗？

提前致谢...

更新:

根据 Brendan 的建议，我将其切换为 JSON 序列化器:

add.apply_async(args=[10, 10], serializer="json")

供 future 搜索者引用，在这种特定的空情况下，JSON 格式似乎大了大约 15%(或 28 字节):

JSON serialized version from celery

另外，对于那些可能有兴趣阅读 c++ 的 pickle 格式的人，我发现这个问题很有帮助: How can I read a python pickle database/file from C?

更新 2:

根据 Asksol 的建议，我尝试了 zlib 压缩:

async_result = add.apply_async( (x, y), compression='zlib' )

我认为有一些有趣的结果，所以在这里:

Format comparison table

如您在此示例中所见，Pickle 格式比 JSON 小。然而，当压缩被添加到混合中时，压缩的 JSON 实际上比 Pickle 的任何一个版本都小。我也很好奇这两种格式的解析时间。虽然 JSON 是为提高解析器性能而设计的，但 Pickle 是基于偏移量的，这意味着它不必迭代。我想知道是否有人对这两种格式(有压缩和无压缩)进行了任何性能基准测试，并考虑了解析 CPU 时间。

最佳答案

According to the documentation ，您可以让 Celery 改用 JSON。我建议这样做，因为无论您使用哪种语言，它都是非常标准的。如果您使用大量二进制数据，则可能会增加消息的大小。

Data transferred between clients and workers needs to be serialized. The default serializer is pickle, but you can change this globally or for each individual task. There is built-in support for pickle, JSON, YAML and msgpack, and you can also add your own custom serializers by registering them into the Kombu serializer registry (see Kombu: Serialization of Data).

关于python - 使用来自非 python 的 pickle 二进制格式(使用 celery 和 rabbitmq)，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/12184460/

24

4

0

文章推荐： c# - WCF 3.5 与 4.0 RESTful 服务性能对比

文章推荐： c# - 使用网络响应加载网络浏览器

celery - celery 拍打不正常
当我运行此命令进行 celery 节拍时。 [2013-06-27 02:17:05,936: INFO/MainProcess] Celerybeat: Starting... [2013-06-2
celery - Celery 任务可以在重启后存活吗？
我需要构建一个处理两种类型任务的系统。一种类型可以创建更多自身或另一种类型的任务。将有很少的 worker (2-3)和只有一个主机。最重要的要求是系统应该优雅地处理重新启动:即在重新启动时，正在进行
celery - 更改内置 celery 任务的超时(即 celery.backend_cleanup)
我们使用 Celery 4.2.1 和 Redis，并为我们的任务设置了全局软超时和硬超时。我们所有的自定义任务都设计为保持在限制范围内，但每天内置任务 backend_cleanup 任务最终都会因
celery - celery 延迟的阻塞版本？
我知道这违背了使用 Celery 的全部目的，但是是否有一个函数会阻塞直到结果返回？所以我可以调用 actual_result = MyTask.dont_delay(some_arg="foo")
celery - 更改内置 celery 任务的超时(即 celery.backend_cleanup)
我们使用 Celery 4.2.1 和 Redis，并为我们的任务设置了全局软超时和硬超时。我们所有的自定义任务都设计为保持在限制范围内，但每天内置任务 backend_cleanup 任务最终都会因
celery - celery 延迟的阻塞版本？
我知道这违背了使用 Celery 的全部目的，但是是否有一个函数会阻塞直到结果返回？所以我可以调用 actual_result = MyTask.dont_delay(some_arg="foo")
celery - Celery 中的回滚支持
我计划使用 celery 作为我的项目的任务管理组件。它几乎具有我的项目所需的所有功能。我将有一组可以独立执行或按指定顺序执行的任务。在顺序任务中，我希望能够在中间任务之一失败时执行清理/回滚。我想知
celery - Celery 工作节点到底是什么？
它是运行 Celery 的实际处理器还是另一个进程？在花中，我可以在工作池中看到多个进程吗？这两者之间有什么区别？最佳答案当您运行 celery worker 时，它会创建一个父进程来管理正在运行
python - 如何解决 celery 文件中带有关键字参数命名空间 ='"CELERY 错误的 celery worker 配置
我有一个名为 ShippingApp 的项目，我按照步骤设置了 celery worker。我将 celery 3.1.26.post2 与 python3.7 一起使用，当我想启动 Celery W
celery - 不能杀死 celery worker
尽我所能，我无法杀死这些 celery worker 。我跑: celery --app=my_app._celery:app status 我看到我有3个(我不明白为什么3个 worker = 2
celery - 使用命令行检查 celery 配置
我在 docker 容器中运行了 celery ，我想检查选项 CELERY_TASK_RESULT_EXPIRES = '3600' 是否已应用。我尝试使用 celery inspect conf
celery - 在 celery 中打破无限循环
我使用 celery.chord(...) 创建一组任务和一个方法，该方法在组中的所有任务完成后被调用。我使用 amqp 结果后端(但我想切换到 memcached)。我的 worker 每秒钟一
celery - 将生成的列表映射到 celery 中的任务的最佳方法
我正在寻找一些关于将任务生成的列表映射到 celery 中的另一个任务的最佳方法的建议。假设我有一个名为 parse 的任务，它解析 PDF 文档并输出页面列表。然后，每个页面都需要单独传递给另一个
celery - 在客户端/生产者上记录 celery
这不是关于如何捕获 celery worker 日志的问题。有什么方法可以捕获生产者上的 celery 日志记录。我想要的是捕获当我调用 task.delay(...) 或 task.apply_as
celery - 如何重新排列 celery 花默认列？
我正在使用以下版本: 花==0.9.3 celery ==4.3.0 这为我提供了包含多个列的任务页面的以下显示: 每次我进入这个页面时，我最终都会重新排列页面，使列的顺序不同，并将行的顺序更改为降序
celery - 安排 Celery 任务在其他任务完成后运行
我想完成这样的事情: results = [] for i in range(N): data = generate_data_slowly() res = tasks.process
celery - 如何在 celery 中安排链式任务
我想运行一个由beat 调度的复杂任务。让我们假设定义了默认的 add/mul 任务。 @app.on_after_configure.connect def setup_periodic_tasks
celery - 重新部署时如何避免中断正在运行的 Celery 任务？
我有一个应用程序，其中包含 celery worker 。当我部署这将杀死那些正在运行的进程。所以任务将开始，但永远不会完成，并且在部署完成时不会重新启动。避免此问题并在部署完成后重新启动这些任务
celery - 如何诊断挂起的 Celery worker
我正在开始使用 Celery 进行 Django 项目。出于本地开发目的，我根据这些说明使用 djcelery 和 djkombu(数据库传输)进行了设置 http://ask.github.com/
celery - 如何配置 Celery 在任务失败时发送电子邮件警报？
如何配置 celery 在任务失败时发送电子邮件警报？例如，我希望 Celery 在 3 个以上的任务失败或 10 个以上的任务被重试时通知我。是否可以使用 celery 或实用程序(例如花)，或

首页

博学

6Ren·AI

商城

python - 使用来自非 python 的 pickle 二进制格式(使用 celery 和 rabbitmq)