multithreading - 改进线程调度策略

转载作者：塔克拉玛干更新时间：2023-11-03 03:45:05

25

4

我需要帮助来增强我正在研究的线程调度策略。

背景

为了设置上下文，我有几个(20-30,000)个“任务”需要执行。每个任务都可以独立执行。实际上，任务的执行时间范围在 40 毫秒到 5 分钟之间变化。此外，重新运行时每个单独的任务都需要相同的时间。

我需要选项来控制这些任务的执行方式，所以我想出了一个调度引擎，可以根据各种策略来调度这些任务。最基本的策略是 FCFS，即我的任务一个接一个地按顺序执行。第二个是批处理策略，调度器有一个桶大小“b”，它控制有多少线程可以并行运行。调度程序将为它获得的第一个“b”任务启动非阻塞线程，然后等待那些启动的任务完成，然后继续下一个“b”任务，并行启动它们，然后等待完成。一次处理的每个“b”组任务称为一个批处理，因此称为批处理调度。

现在，有了批处理调度，事件在批处理开始时开始增加，当线程开始创建时，然后在中间达到峰值，此时大多数线程都在运行，然后随着我们阻塞和等待而减弱用于线程重新加入。当批处理大小“b”= 1 时，批处理调度变为 FCFS 调度。

改进批处理调度的一种方法是我将其称为并行调度——调度程序将确保，如果存在足够数量的任务，“b”个线程将在任何时间点保持运行。线程数最初会增加到“b”，然后将计数保持在“b”个运行线程，直到最后一组任务完成执行。为了随时保持“b”个线程的执行，我们需要在旧线程执行完的那一刻启动一个新线程。与批量调度(平均案例场景)相比，这种方法可以减少完成处理所有任务所花费的时间。

我需要帮助的地方

我必须实现并行调度的逻辑如下。如果有人可以帮助我，我将不胜感激:

我们能否避免使用启动任务列表？我正在用那个因为我需要确定什么时候Commit() 退出，所有任务都有完成执行，所以我只是循环通过所有 startedTasks 和 block 直到它们完成。一电流问题是列表会很长。

--或者--

是否有更好的并行调度方法？

(也欢迎任何其他建议/策略 - 这里的主要目标是在批大小“b”的限制内缩短整体执行时间)

ParallelScheduler 伪代码

// assume all variable access/updates are thread safe
Semaphore S: with an initial capacity of "b"
Queue<Task> tasks
List<Task> startedTasks
bool allTasksCompleted = false;

// The following method is called by a callee
// that wishes to start tasks, it can be called any number of times
// passing various task items
METHOD void ScheduleTask( Task t )

    if the PollerThread not started yet then start it 
    // starting PollerThead will call PollerThread_Action


    // set up the task so that when it is completed, it releases 1
    // on semaphore S
    // assume OnCompleted is executed when the task t completes
    // execution after a call to t.Start()
    t.OnCompleted() ==> S.Release(1)

    tasks.Enqueue ( t )


// This method is called when the callee
// wishes to notify that no more tasks are present that needs
// a ScheduleTask call.
METHOD void Commit()
    // assume that the following assignment is thread safe
    stopPolling = true;

    // assume that the following check is done efficiently
    wait until allTasksCompleted is set to true


// this is the method the poller thread once started will execute
METHOD void PollerThread_Action
    while ( !stopPolling )
        if ( tasks.Count > 0 )
            Task nextTask = tasks.Deque()
            // wait on the semaphore to relase one unit
            if ( S.WaitOne() )              
                // start the task in a new thread
                nextTask.Start()
                startedTasks.Add( nextTask )
    // we have been asked to start polling
    // this means no more tasks are going to be added
    // to the queue
    // finish off the remaining tasks
    while ( tasks.Count > 0 )
        Task nextTask = tasks.Dequeue()
        if ( S.WaitOne() )
            nextTask.Start()
            startedTasks.Add ( nextTask )

    // at this point, there are no more tasks in the queue
    // each task would have already been started at some
    // point
    for every Task t in startedTasks
        t.WaitUntilComplete() // this will block if a task is running, else exit immediately

    // now all tasks are complete
    allTasksCompleted = true

最佳答案

搜索“work stealing scheduler”——它是最高效的通用调度程序之一。周围还有一些开源和商业实现。

想法是拥有固定数量的工作线程，从队列中获取任务。但是为了避免所有线程共享的单个队列的拥塞(多 CPU 系统的性能问题非常糟糕)——每个线程都有自己的队列。当一个线程创建新任务时 - 它会将它们放入自己的队列中。完成任务后，线程从自己的队列中获取下一个任务。但是，如果线程的队列为空，它就会从其他线程的队列中“窃取”工作。

关于multithreading - 改进线程调度策略，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/6365744/

25

4

0

文章推荐： algorithm - 关于leader选举的一些想法

文章推荐： java - 生成等号和哈希码时忽略属性

文章推荐： javascript - html/javascript/css 中的打包图像流

检查不良做法/改进
我对编码还比较陌生，但并非完全没有经验。处理有关金融计算器的学校作业。如果你们中的任何人可以查看我的代码以了解不良做法/可能的改进等，那就太好了。我确实添加了一个“动画”启动(有很多 printf
小目标检测改进拆分拼接
小目标Trick 论文链接： https://paperswithcode.com/paper/slicing-aided-hyper-inference-and-fine-tuning 代码链接：h
javascript - 改进 if 语句链
if (firstPositionCpc && (firstPosition > 0 && firstPositionCpc 0 && topOfPageCpc 0 && firstPageCpc
SQL 改进 - UNION？
我有 2 个表:“packages”和“items”。 “packages”有以下列:pack_id | item_id “items”有以下列......:item_id |输入一个包可以有多个
python - Pandas 改进
我目前有一个 Pandas Dataframe，我在其中执行列之间的比较。我发现一种情况，在进行比较时存在空列，由于某种原因比较返回 else 值。我添加了一个额外的语句来将其清理为空。看看我是否可以
具有四舍五入的主日期时间键的 MySQL 改进
我正在处理一个查询，通过首先舍入它们的主要日期时间键来连接一个数据库中的多个表。数据库包含来自 openhab 的性能数据，每个表只有一个名为 Time 的主日期时间行和一个名为 Value 的值行。
即发即弃的 C# 改进
问候我有一个程序创建一个类的多个实例，在所有实例上运行相同的长时间运行的 Update 方法并等待完成。我从 this question 开始关注 Kev 的方法将更新添加到 ThreadPool.
c - 对我的简单二十一点程序的建议/改进
我想在下学期的类(class)中取得领先，所以我制作了这个基本版本的 Blackjack 来开始理解 C 的基础知识，我希望您有任何想法可以帮助我更好地理解 C 和其正常的编码实践。 C 中的很多东西
javascript - 需要更好的解决方案/改进
我有一个要求，比如: 给定一个数组，其中包含随机数。需要输出元素出现的次数，有自带解决方案: var myArr = [3,2,1,2,3,1,4,5,4,6,7,7,9,1,123,0,123];
sql - min() 改进
这是我的数据库项目。表user_ select id, name from user_; id | name ----+---------- 1 | bartek 2 | bartek
bash - 改进 for 循环的执行
我已经完成了一个小批量脚本来调整(动态)一些图像的大小: for a in *.{png,PNG,jpg,JPG,jpeg,JPEG,bmp,BMP} ; do convert "$a" -resiz
列表理解中函数的 Pythonic 改进？
是否有更 pythonic 的方法来执行以下代码？我想在一行中完成 parsed_rows 是一个可以返回大小为 3 或 None 的元组的函数。 parsed_rows = [ parse_row(
选项转换器的 Javascript 改进
关闭。这个问题是opinion-based .它目前不接受答案。想要改进这个问题？更新问题，以便 editing this post 可以用事实和引用来回答它. 关闭 9 年前。 Improv
python - 列表到字典 - 改进？
下面的代码完成了我想要的，但还有其他更像 python 风格的方式吗？文件格式: key1:value1,key2:value2,... key21:value21,key22:value22,..
java - 检查字符串中是否存在字符集 - 改进
如果两个英文单词只包含相同的字母，则它们是相似的。例如，food 和 good 不相似，但 dog 和 good 相似。 (如果A与B相似，则A中的所有字母都包含在B中，B中的所有字母都包含在A中。)
c - 强平衡树 - 改进
我有以下结构来表示二叉树: typedef struct node *pnode; typedef struct node { int val; pnode left; pnode
algorithm - 改进 a* 搜索以在三角环境中寻找路径
我有一个区域，它由受约束的 delaunay 三角剖分表示。我正在解决在两点之间寻找路径的问题。我正在使用 Marcelo Kallmann 提供的论文作为解决此问题的引用点。然而，而不是使用 Kal
java - 使用正则表达式的性能开销/改进
如果我需要检查文本(字符串)中是否存在单词 A 或单词 B，如果我这样做会有性能差异: if(text.contains(wordA) || text.contains(wordB)) 要使用一些正则
xml - Xpath 改进
Adjust To 我有上面这个简单的页面，上面有一个标签和一个文本框。我想在文本框中输入文本。对我有帮助的 XPATH 是 //*[contains(tex
elisp - 改进 Elisp 条件表达式
以下伪代码的elisp代码 if "the emacs version is less than 23.1.x" do something else something-else 写成 (if

首页

博学

6Ren·AI

商城

multithreading - 改进线程调度策略

背景

我需要帮助的地方

ParallelScheduler 伪代码