python - 分布式 celery 调度器-6ren

python - 分布式 celery 调度器

转载作者：太空狗更新时间：2023-10-29 19:25:52

27

4

我正在为 Python 寻找类似 cron 的分布式框架，并找到了 Celery。然而，文档说“你必须确保一次只有一个调度程序在为一个计划运行，否则你最终会得到重复的任务”，Celery 使用 celery.beat.PersistentScheduler 将计划存储到本地文件。

所以，我的问题是，除了默认设置之外，还有其他实现可以将调度“放入集群”并协调任务执行，以便每个任务只运行一次吗？我的目标是能够在集群中的所有主机上以相同的时间表运行 celerybeat。

谢谢

最佳答案

tl;dr:没有 Celerybeat 不适合您的用例。您只需运行一个 celerybeat 进程，否则您的任务将重复。

我知道这是一个非常古老的问题。我会尝试做一个小总结，因为我有同样的问题/问题(在 2018 年)。

一些背景:我们在 Kubernetes 集群中运行 Django 应用程序(使用 Celery)。集群(EC2 实例)和 Pod(~容器)是自动缩放的:简单地说，我不知道应用程序的运行时间和数量。

您有责任只运行 celerybeat 的一个进程，否则，您的任务将被重复。 [1] Celery 存储库中有此功能请求:[2]

Requiring the user to ensure that only one instance of celerybeat exists across their cluster creates a substantial implementation burden (either creating a single point-of-failure or encouraging users to roll their own distributed mutex).

celerybeat should either provide a mechanism to prevent inadvertent concurrency, or the documentation should suggest a best-practice approach.

一段时间后，这个功能请求被 Celery 的作者以资源不足为由拒绝了。 [3] 我强烈建议阅读 Github 上的整个帖子。那里的人推荐这些项目/解决方案:

我没有尝试上面的任何操作(我不希望我的应用程序中有其他依赖项，我不喜欢锁定任务/你需要处理故障转移等/)。

我最终在 Kubernetes 中使用了 CronJob (https://kubernetes.io/docs/concepts/workloads/controllers/cron-jobs/)。

[1] celerybeat - multiple instances & monitoring

[2] https://github.com/celery/celery/issues/251

[3] https://github.com/celery/celery/issues/251#issuecomment-228214951

关于python - 分布式 celery 调度器，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/7011950/

27

4

0

文章推荐： python - 包中 Python 目录的典型命名约定

文章推荐： python - Autohotkey 和 python 之间的通信

文章推荐： oop - 在 Python 中启用用户代码扩展的流行技术是什么？

celery - celery 拍打不正常
当我运行此命令进行 celery 节拍时。 [2013-06-27 02:17:05,936: INFO/MainProcess] Celerybeat: Starting... [2013-06-2
celery - Celery 任务可以在重启后存活吗？
我需要构建一个处理两种类型任务的系统。一种类型可以创建更多自身或另一种类型的任务。将有很少的 worker (2-3)和只有一个主机。最重要的要求是系统应该优雅地处理重新启动:即在重新启动时，正在进行
celery - 更改内置 celery 任务的超时(即 celery.backend_cleanup)
我们使用 Celery 4.2.1 和 Redis，并为我们的任务设置了全局软超时和硬超时。我们所有的自定义任务都设计为保持在限制范围内，但每天内置任务 backend_cleanup 任务最终都会因
celery - celery 延迟的阻塞版本？
我知道这违背了使用 Celery 的全部目的，但是是否有一个函数会阻塞直到结果返回？所以我可以调用 actual_result = MyTask.dont_delay(some_arg="foo")
celery - 更改内置 celery 任务的超时(即 celery.backend_cleanup)
我们使用 Celery 4.2.1 和 Redis，并为我们的任务设置了全局软超时和硬超时。我们所有的自定义任务都设计为保持在限制范围内，但每天内置任务 backend_cleanup 任务最终都会因
celery - celery 延迟的阻塞版本？
我知道这违背了使用 Celery 的全部目的，但是是否有一个函数会阻塞直到结果返回？所以我可以调用 actual_result = MyTask.dont_delay(some_arg="foo")
celery - Celery 中的回滚支持
我计划使用 celery 作为我的项目的任务管理组件。它几乎具有我的项目所需的所有功能。我将有一组可以独立执行或按指定顺序执行的任务。在顺序任务中，我希望能够在中间任务之一失败时执行清理/回滚。我想知
celery - Celery 工作节点到底是什么？
它是运行 Celery 的实际处理器还是另一个进程？在花中，我可以在工作池中看到多个进程吗？这两者之间有什么区别？最佳答案当您运行 celery worker 时，它会创建一个父进程来管理正在运行
python - 如何解决 celery 文件中带有关键字参数命名空间 ='"CELERY 错误的 celery worker 配置
我有一个名为 ShippingApp 的项目，我按照步骤设置了 celery worker。我将 celery 3.1.26.post2 与 python3.7 一起使用，当我想启动 Celery W
celery - 不能杀死 celery worker
尽我所能，我无法杀死这些 celery worker 。我跑: celery --app=my_app._celery:app status 我看到我有3个(我不明白为什么3个 worker = 2
celery - 使用命令行检查 celery 配置
我在 docker 容器中运行了 celery ，我想检查选项 CELERY_TASK_RESULT_EXPIRES = '3600' 是否已应用。我尝试使用 celery inspect conf
celery - 在 celery 中打破无限循环
我使用 celery.chord(...) 创建一组任务和一个方法，该方法在组中的所有任务完成后被调用。我使用 amqp 结果后端(但我想切换到 memcached)。我的 worker 每秒钟一
celery - 将生成的列表映射到 celery 中的任务的最佳方法
我正在寻找一些关于将任务生成的列表映射到 celery 中的另一个任务的最佳方法的建议。假设我有一个名为 parse 的任务，它解析 PDF 文档并输出页面列表。然后，每个页面都需要单独传递给另一个
celery - 在客户端/生产者上记录 celery
这不是关于如何捕获 celery worker 日志的问题。有什么方法可以捕获生产者上的 celery 日志记录。我想要的是捕获当我调用 task.delay(...) 或 task.apply_as
celery - 如何重新排列 celery 花默认列？
我正在使用以下版本: 花==0.9.3 celery ==4.3.0 这为我提供了包含多个列的任务页面的以下显示: 每次我进入这个页面时，我最终都会重新排列页面，使列的顺序不同，并将行的顺序更改为降序
celery - 安排 Celery 任务在其他任务完成后运行
我想完成这样的事情: results = [] for i in range(N): data = generate_data_slowly() res = tasks.process
celery - 如何在 celery 中安排链式任务
我想运行一个由beat 调度的复杂任务。让我们假设定义了默认的 add/mul 任务。 @app.on_after_configure.connect def setup_periodic_tasks
celery - 重新部署时如何避免中断正在运行的 Celery 任务？
我有一个应用程序，其中包含 celery worker 。当我部署这将杀死那些正在运行的进程。所以任务将开始，但永远不会完成，并且在部署完成时不会重新启动。避免此问题并在部署完成后重新启动这些任务
celery - 如何诊断挂起的 Celery worker
我正在开始使用 Celery 进行 Django 项目。出于本地开发目的，我根据这些说明使用 djcelery 和 djkombu(数据库传输)进行了设置 http://ask.github.com/
celery - 如何配置 Celery 在任务失败时发送电子邮件警报？
如何配置 celery 在任务失败时发送电子邮件警报？例如，我希望 Celery 在 3 个以上的任务失败或 10 个以上的任务被重试时通知我。是否可以使用 celery 或实用程序(例如花)，或

首页

博学

6Ren·AI

商城

python - 分布式 celery 调度器