From: Luis Machado <luis.machado@arm.com>
To: Peter Zijlstra <peterz@infradead.org>
Cc: mingo@redhat.com, juri.lelli@redhat.com,
vincent.guittot@linaro.org, dietmar.eggemann@arm.com,
rostedt@goodmis.org, bsegall@google.com, mgorman@suse.de,
bristot@redhat.com, vschneid@redhat.com,
linux-kernel@vger.kernel.org, kprateek.nayak@amd.com,
wuyun.abel@bytedance.com, tglx@linutronix.de, efault@gmx.de,
John Stultz <jstultz@google.com>,
Hongyan.Xia2@arm.com
Subject: Re: [RFC][PATCH 08/10] sched/fair: Implement delayed dequeue
Date: Wed, 12 Jun 2024 16:08:08 +0100 [thread overview]
Message-ID: <9098c152-c618-4e0f-ab59-0cec5cdb3e5b@arm.com> (raw)
In-Reply-To: <20240605094231.GR26599@noisy.programming.kicks-ass.net>
On 6/5/24 10:42, Peter Zijlstra wrote:
> On Wed, Jun 05, 2024 at 10:14:47AM +0100, Luis Machado wrote:
>> ... thanks for the patch! The above seems to do it for me. I can see
>> more reasonable energy use with the eevdf-complete series. Still a
>> bit higher. Might be noise, we'll see.
>
> W00t!!!
>
> Let me write a decent Changelog and stuff it in the git tree along with
> all the other bits.
>
> Thanks for all the testing.
I've been doing some more testing of the eevdf-complete series with
the Pixel6/EAS platform. Hopefully these numbers will prove useful.
The energy regression from the original delayed-dequeue patch seems to
have been mostly fixed (with your proposed patch). Energy readings for
the big and mid cores are mostly stable and comparable with stock eevdf
(without eevdf-complete).
The only difference I can spot now is in the energy use of the little
cores. Compared to stock eevdf, the delayed-dequeue code seems to make
the energy use of the little cores a bit spiky, meaning sometimes we get
the expected level of energy use, but other times we get 40%, 60% or
even 90% more.
For instance...
(1) m6.6-eevdf-stock*: stock eevdf runs
(2) m6.6-eevdf-complete-ndd-dz*: eevdf-complete + NO_DELAY_DEQUEUE + DELAY_ZERO
(3) m6.6-eevdf-complete-dd-dz*: eevdf-complete + DELAY_DEQUEUE + DELAY_ZERO
+------------+---------------------------------+-----------+
| channel | tag | perc_diff |
+------------+---------------------------------+-----------+
| CPU-Little | m6.6-eevdf-stock-1 | 0.0% |
| CPU-Little | m6.6-eevdf-stock-2 | -4.21% |
| CPU-Little | m6.6-eevdf-stock-3 | -7.86% |
| CPU-Little | m6.6-eevdf-stock-4 | -5.67% |
| CPU-Little | m6.6-eevdf-stock-5 | -6.61% |
| CPU-Little | m6.6-eevdf-complete-ndd-dz-1 | -2.21% |
| CPU-Little | m6.6-eevdf-complete-ndd-dz-2 | -9.99% |
| CPU-Little | m6.6-eevdf-complete-ndd-dz-3 | -6.1% |
| CPU-Little | m6.6-eevdf-complete-ndd-dz-4 | -5.66% |
| CPU-Little | m6.6-eevdf-complete-ndd-dz-5 | -7.12% |
| CPU-Little | m6.6-eevdf-complete-dd-dz-1 | 96.69% |
| CPU-Little | m6.6-eevdf-complete-dd-dz-2 | 22.1% |
| CPU-Little | m6.6-eevdf-complete-dd-dz-3 | 44.82% |
| CPU-Little | m6.6-eevdf-complete-dd-dz-4 | -0.23% |
| CPU-Little | m6.6-eevdf-complete-dd-dz-5 | 8.28% |
+------------+---------------------------------+-----------+
Looking at what might explain the spiky behavior with DELAY_DEQUEUE, I
noticed the idle residency data (we have 2 idle states) also shows some
spikyness and potential clues.
Looks like (1) and (2) manage to switch to idle states in a consistent
manner, whereas (3) seems a bit erratic and more prone to take a
shallower idle state (idle 0) as opposed to a deeper idle state (idle 1).
(1) and (2) seem to make better use of the deeper idle state.
+-------------------------------+---------+------------+-------+
| tag | cluster | idle_state | time |
+-------------------------------+---------+------------+-------+
| m6.6-eevdf-stock-1 | little | not idle | 63.49 |
| m6.6-eevdf-stock-1 | little | idle 0 | 30.66 |
| m6.6-eevdf-stock-1 | little | idle 1 | 12.15 |
| m6.6-eevdf-stock-2 | little | not idle | 62.6 |
| m6.6-eevdf-stock-2 | little | idle 0 | 31.13 |
| m6.6-eevdf-stock-2 | little | idle 1 | 14.56 |
| m6.6-eevdf-stock-3 | little | not idle | 63.98 |
| m6.6-eevdf-stock-3 | little | idle 0 | 31.54 |
| m6.6-eevdf-stock-3 | little | idle 1 | 15.91 |
| m6.6-eevdf-stock-4 | little | not idle | 64.18 |
| m6.6-eevdf-stock-4 | little | idle 0 | 31.32 |
| m6.6-eevdf-stock-4 | little | idle 1 | 15.83 |
| m6.6-eevdf-stock-5 | little | not idle | 63.32 |
| m6.6-eevdf-stock-5 | little | idle 0 | 30.4 |
| m6.6-eevdf-stock-5 | little | idle 1 | 14.33 |
| m6.6-eevdf-complete-ndd-dz-1 | little | not idle | 62.62 |
| m6.6-eevdf-complete-ndd-dz-1 | little | idle 0 | 29.48 |
| m6.6-eevdf-complete-ndd-dz-1 | little | idle 1 | 13.19 |
| m6.6-eevdf-complete-ndd-dz-2 | little | not idle | 64.12 |
| m6.6-eevdf-complete-ndd-dz-2 | little | idle 0 | 27.62 |
| m6.6-eevdf-complete-ndd-dz-2 | little | idle 1 | 14.73 |
| m6.6-eevdf-complete-ndd-dz-3 | little | not idle | 62.86 |
| m6.6-eevdf-complete-ndd-dz-3 | little | idle 0 | 27.87 |
| m6.6-eevdf-complete-ndd-dz-3 | little | idle 1 | 14.97 |
| m6.6-eevdf-complete-ndd-dz-4 | little | not idle | 63.01 |
| m6.6-eevdf-complete-ndd-dz-4 | little | idle 0 | 28.2 |
| m6.6-eevdf-complete-ndd-dz-4 | little | idle 1 | 14.11 |
| m6.6-eevdf-complete-ndd-dz-5 | little | not idle | 62.1 |
| m6.6-eevdf-complete-ndd-dz-5 | little | idle 0 | 29.06 |
| m6.6-eevdf-complete-ndd-dz-5 | little | idle 1 | 14.73 |
| m6.6-eevdf-complete-dd-dz-1 | little | not idle | 46.18 |
| m6.6-eevdf-complete-dd-dz-1 | little | idle 0 | 53.78 |
| m6.6-eevdf-complete-dd-dz-1 | little | idle 1 | 3.75 |
| m6.6-eevdf-complete-dd-dz-2 | little | not idle | 57.64 |
| m6.6-eevdf-complete-dd-dz-2 | little | idle 0 | 40.47 |
| m6.6-eevdf-complete-dd-dz-2 | little | idle 1 | 7.39 |
| m6.6-eevdf-complete-dd-dz-3 | little | not idle | 43.14 |
| m6.6-eevdf-complete-dd-dz-3 | little | idle 0 | 57.73 |
| m6.6-eevdf-complete-dd-dz-3 | little | idle 1 | 3.65 |
| m6.6-eevdf-complete-dd-dz-4 | little | not idle | 58.97 |
| m6.6-eevdf-complete-dd-dz-4 | little | idle 0 | 36.4 |
| m6.6-eevdf-complete-dd-dz-4 | little | idle 1 | 9.42 |
| m6.6-eevdf-complete-dd-dz-5 | little | not idle | 55.85 |
| m6.6-eevdf-complete-dd-dz-5 | little | idle 0 | 36.75 |
| m6.6-eevdf-complete-dd-dz-5 | little | idle 1 | 13.14 |
+-------------------------------+---------+------------+-------+
I can't draw a precise conclusion, but it might be down to delayed util_est
updates or even the additional time the delayed-dequeue tasks spend on the
runqueue. But delayed-dequeue does change the overall behavior a bit on
these heterogeneous platforms, energy-wise.
next prev parent reply other threads:[~2024-06-12 15:08 UTC|newest]
Thread overview: 77+ messages / expand[flat|nested] mbox.gz Atom feed top
2024-04-05 10:27 [RFC][PATCH 00/10] sched/fair: Complete EEVDF Peter Zijlstra
2024-04-05 10:27 ` [RFC][PATCH 01/10] sched/eevdf: Add feature comments Peter Zijlstra
2024-04-05 10:27 ` [RFC][PATCH 02/10] sched/eevdf: Remove min_vruntime_copy Peter Zijlstra
2024-04-05 10:27 ` [RFC][PATCH 03/10] sched/fair: Cleanup pick_task_fair() vs throttle Peter Zijlstra
2024-04-05 21:11 ` Benjamin Segall
2024-04-05 10:27 ` [RFC][PATCH 04/10] sched/fair: Cleanup pick_task_fair()s curr Peter Zijlstra
2024-04-05 10:27 ` [RFC][PATCH 05/10] sched/fair: Unify pick_{,next_}_task_fair() Peter Zijlstra
2024-04-06 2:20 ` Mike Galbraith
2024-04-05 10:28 ` [RFC][PATCH 06/10] sched: Allow sched_class::dequeue_task() to fail Peter Zijlstra
2024-04-05 10:28 ` [RFC][PATCH 07/10] sched/fair: Re-organize dequeue_task_fair() Peter Zijlstra
2024-04-05 10:28 ` [RFC][PATCH 08/10] sched/fair: Implement delayed dequeue Peter Zijlstra
2024-04-06 9:23 ` Chen Yu
2024-04-08 9:06 ` Peter Zijlstra
2024-04-11 1:32 ` Yan-Jie Wang
2024-04-25 10:25 ` Peter Zijlstra
2024-04-12 10:42 ` K Prateek Nayak
2024-04-15 10:56 ` Mike Galbraith
2024-04-16 3:18 ` K Prateek Nayak
2024-04-16 5:36 ` Mike Galbraith
2024-04-18 16:24 ` Mike Galbraith
2024-04-18 17:08 ` K Prateek Nayak
2024-04-24 15:20 ` Peter Zijlstra
2024-04-25 11:28 ` Peter Zijlstra
2024-04-26 10:56 ` Peter Zijlstra
2024-04-26 11:16 ` Peter Zijlstra
2024-04-26 16:03 ` Mike Galbraith
2024-04-27 6:42 ` Mike Galbraith
2024-04-28 16:32 ` Mike Galbraith
2024-04-29 12:14 ` Peter Zijlstra
2024-04-15 17:07 ` Luis Machado
2024-04-24 15:15 ` Luis Machado
2024-04-25 10:42 ` Peter Zijlstra
2024-04-25 11:49 ` Peter Zijlstra
2024-04-26 9:32 ` Peter Zijlstra
2024-04-26 9:36 ` Peter Zijlstra
2024-04-26 10:16 ` Luis Machado
2024-04-29 14:33 ` Luis Machado
2024-05-02 10:26 ` Luis Machado
2024-05-10 14:49 ` Luis Machado
2024-05-15 9:36 ` Peter Zijlstra
2024-05-15 11:48 ` Peter Zijlstra
2024-05-15 18:03 ` Mike Galbraith
2024-05-20 15:20 ` Luis Machado
2024-05-29 22:50 ` Peter Zijlstra
2024-06-03 19:30 ` Luis Machado
2024-06-04 10:11 ` Peter Zijlstra
2024-06-04 13:59 ` Hongyan Xia
2024-06-04 14:23 ` Luis Machado
2024-06-04 14:49 ` Hongyan Xia
2024-06-04 19:12 ` Peter Zijlstra
2024-06-05 7:22 ` Peter Zijlstra
2024-06-05 9:14 ` Luis Machado
2024-06-05 9:42 ` Peter Zijlstra
2024-06-12 15:08 ` Luis Machado [this message]
2024-05-23 8:45 ` Peter Zijlstra
2024-05-23 9:06 ` Luis Machado
2024-05-23 9:33 ` Peter Zijlstra
2024-06-03 15:57 ` Hongyan Xia
2024-04-26 10:15 ` Luis Machado
2024-04-20 5:57 ` Mike Galbraith
2024-04-22 13:13 ` Tobias Huschle
[not found] ` <CA44DAC1-B01A-4208-B9A0-D824E8178974@oracle.com>
2024-07-02 13:08 ` Peter Zijlstra
2024-04-05 10:28 ` [RFC][PATCH 09/10] sched/eevdf: Allow shorter slices to wakeup-preempt Peter Zijlstra
2024-04-05 10:28 ` [RFC][PATCH 10/10] sched/eevdf: Use sched_attr::sched_runtime to set request/slice suggestion Peter Zijlstra
2024-04-06 8:16 ` Hillf Danton
2024-05-07 5:34 ` Mike Galbraith
2024-05-15 10:13 ` Peter Zijlstra
2024-05-07 15:15 ` Chen Yu
2024-05-08 13:52 ` Mike Galbraith
2024-05-09 3:48 ` Chen Yu
2024-05-09 5:00 ` Mike Galbraith
2024-05-13 4:07 ` K Prateek Nayak
2024-05-14 9:18 ` Chen Yu
2024-05-14 15:23 ` K Prateek Nayak
2024-05-14 16:15 ` Chen Yu
2024-05-22 14:48 ` Chen Yu
2024-05-27 10:11 ` [RFC][PATCH 00/10] sched/fair: Complete EEVDF K Prateek Nayak
Reply instructions:
You may reply publicly to this message via plain-text email
using any one of the following methods:
* Save the following mbox file, import it into your mail client,
and reply-to-all from there: mbox
Avoid top-posting and favor interleaved quoting:
https://en.wikipedia.org/wiki/Posting_style#Interleaved_style
* Reply using the --to, --cc, and --in-reply-to
switches of git-send-email(1):
git send-email \
--in-reply-to=9098c152-c618-4e0f-ab59-0cec5cdb3e5b@arm.com \
--to=luis.machado@arm.com \
--cc=Hongyan.Xia2@arm.com \
--cc=bristot@redhat.com \
--cc=bsegall@google.com \
--cc=dietmar.eggemann@arm.com \
--cc=efault@gmx.de \
--cc=jstultz@google.com \
--cc=juri.lelli@redhat.com \
--cc=kprateek.nayak@amd.com \
--cc=linux-kernel@vger.kernel.org \
--cc=mgorman@suse.de \
--cc=mingo@redhat.com \
--cc=peterz@infradead.org \
--cc=rostedt@goodmis.org \
--cc=tglx@linutronix.de \
--cc=vincent.guittot@linaro.org \
--cc=vschneid@redhat.com \
--cc=wuyun.abel@bytedance.com \
/path/to/YOUR_REPLY
https://kernel.org/pub/software/scm/git/docs/git-send-email.html
* If your mail client supports setting the In-Reply-To header
via mailto: links, try the mailto: link
Be sure your reply has a Subject: header at the top and a blank line
before the message body.
This is a public inbox, see mirroring instructions
for how to clone and mirror all data and code used for this inbox
all inboxes | Powered by JetHome®