drm/scheduler: improve job distribution with multiple queues

This patch uses score based logic to select a new rq for better loadbalance between multiple rq/scheds instead of num_jobs. Below are test results after running amdgpu_test from mesa drm Before this patch: sched_name num of many times it got scheduled ========= ================================== sdma0 314 sdma1 32 comp_1.0.0 56 comp_1.0.1 0 comp_1.1.0 0 comp_1.1.1 0 comp_1.2.0 0 comp_1.2.1 0 comp_1.3.0 0 comp_1.3.1 0 After this patch: sched_name num of many times it got scheduled ========= ================================== sdma0 216 sdma1 185 comp_1.0.0 39 comp_1.0.1 9 comp_1.1.0 12 comp_1.1.1 0 comp_1.2.0 12 comp_1.2.1 0 comp_1.3.0 12 comp_1.3.1 0 Signed-off-by: Nirmoy Das <nirmoy.das@amd.com> Reviewed-by: Christian König <christian.koenig@amd.com> Signed-off-by: Alex Deucher <alexander.deucher@amd.com>
author: Nirmoy Das <nirmoy.das@amd.com> 2020-01-15 15:06:04 +0100
committer: Alex Deucher <alexander.deucher@amd.com> 2020-01-16 13:37:54 -0500
commit: 56822db194232c089601728d68ed078dccb97f8b (patch)
tree: c90d40644880a4ba8e6e5166f99bd2d0e76ae05f /drivers/gpu/drm/scheduler/sched_main.c
parent: drm/amdgpu/vcn2.5: implement indirect DPG SRAM mode (diff)
download: linux-dev-56822db194232c089601728d68ed078dccb97f8b.tar.xz
linux-dev-56822db194232c089601728d68ed078dccb97f8b.zip
1 files changed, 4 insertions, 2 deletions
diff --git a/drivers/gpu/drm/scheduler/sched_main.c b/drivers/gpu/drm/scheduler/sched_main.c
index 3fad5876a13f..71ce6215956f 100644
--- a/drivers/gpu/drm/scheduler/sched_main.c
+++ b/drivers/gpu/drm/scheduler/sched_main.c
@@ -92,6 +92,7 @@ void drm_sched_rq_add_entity(struct drm_sched_rq *rq,
 	if (!list_empty(&entity->list))
 		return;
 	spin_lock(&rq->lock);
+	atomic_inc(&rq->sched->score);
 	list_add_tail(&entity->list, &rq->entities);
 	spin_unlock(&rq->lock);
 }
@@ -110,6 +111,7 @@ void drm_sched_rq_remove_entity(struct drm_sched_rq *rq,
 	if (list_empty(&entity->list))
 		return;
 	spin_lock(&rq->lock);
+	atomic_dec(&rq->sched->score);
 	list_del_init(&entity->list);
 	if (rq->current_entity == entity)
 		rq->current_entity = NULL;
@@ -655,7 +657,7 @@ static void drm_sched_process_job(struct dma_fence *f, struct dma_fence_cb *cb)
 	struct drm_gpu_scheduler *sched = s_fence->sched;
 
 	atomic_dec(&sched->hw_rq_count);
-	atomic_dec(&sched->num_jobs);
+	atomic_dec(&sched->score);
 
 	trace_drm_sched_process_job(s_fence);
 
@@ -830,7 +832,7 @@ int drm_sched_init(struct drm_gpu_scheduler *sched,
 	spin_lock_init(&sched->job_list_lock);
 	atomic_set(&sched->hw_rq_count, 0);
 	INIT_DELAYED_WORK(&sched->work_tdr, drm_sched_job_timedout);
-	atomic_set(&sched->num_jobs, 0);
+	atomic_set(&sched->score, 0);
 	atomic64_set(&sched->job_id_count, 0);
 
 	/* Each scheduler will run on a seperate kernel thread */
author	Nirmoy Das <nirmoy.das@amd.com>	2020-01-15 15:06:04 +0100
committer	Alex Deucher <alexander.deucher@amd.com>	2020-01-16 13:37:54 -0500
commit	56822db194232c089601728d68ed078dccb97f8b (patch)
tree	c90d40644880a4ba8e6e5166f99bd2d0e76ae05f /drivers/gpu/drm/scheduler/sched_main.c
parent	drm/amdgpu/vcn2.5: implement indirect DPG SRAM mode (diff)
download	linux-dev-56822db194232c089601728d68ed078dccb97f8b.tar.xz linux-dev-56822db194232c089601728d68ed078dccb97f8b.zip