Groups | Search | Server Info | Keyboard shortcuts | Login | Register [http] [https] [nntp] [nntps]
Groups > linux.kernel > #1399586
| Path | csiph.com!news.mixmin.net!aioe.org!bofh.it!news.nic.it!robomod |
|---|---|
| From | David Carrillo-Cisneros <davidcc@google.com> |
| Newsgroups | linux.kernel |
| Subject | [PATCH v2 26/32] perf/x86/intel/cqm: make one write of PQR_ASSOC per ctx switch |
| Date | Thu, 12 May 2016 01:10:04 +0200 |
| Message-ID | <rxLqs-1mv-53@gated-at.bofh.it> (permalink) |
| References | <rxLqq-1mv-9@gated-at.bofh.it> |
| Dkim-Signature | v=1; a=rsa-sha256; c=relaxed/relaxed; d=google.com; s=20120113; h=from:to:cc:subject:date:message-id:in-reply-to:references; bh=+cU0GNGvwLxlGQxIOY182vLy8DyShirX4bwky+51g9Q=; b=mZBTwuIHySWS4PoP14rMta8ElV2D5pdVEK7wXsLZXcrei/gnp2b4iSVjgEJJ6AZGkK 1lzRA++/UJa7ehzIFRXIr8evrfEniWi0mTx1vSNvzhW6dWOtgVOcOP9QMhX57H7ZbVcP GBHY4v6ggm/bfjMYy2kjcSHyuNNDeMHA6ZmSCY4BGEhtixSPbyD5FHWiInAkYUU4M+zR gT1vftiDswHE4CN7HjxsDqCZPu1GLrYYE0MKCF2U9n1vG4nWS8LCWYuANn905jHy8oot G9D4YTzCqRdZIuYu66J4Lb9lio7ZqGat5lGrp0Lpqq8vyYiKxbElYFiU6x5nJuEFMgrx iDBQ== |
| X-Google-Dkim-Signature | v=1; a=rsa-sha256; c=relaxed/relaxed; d=1e100.net; s=20130820; h=x-gm-message-state:from:to:cc:subject:date:message-id:in-reply-to :references; bh=+cU0GNGvwLxlGQxIOY182vLy8DyShirX4bwky+51g9Q=; b=PUNBIuxKhxdbxY/ubGghmobffMASEkG7sOzWtp2LRNvVaq+AWKbL6D++fo5B/ou4Le zkCeVsSgRf3PGm2WP0BNo80z6ryqQIkjitDhFGPgZksk8Kn6APPhNLvaqLPwnt4TgL2C 158zTNresgocDQ88hiV4FoOG2r2n706OWfvUMJvDwe3jN7MdVtYRjsQHq2J/WEHrbBdi G3PHFlPAlsWpmDVMlNctlufrkp4UPKEjt1MLRgiQwnregBz5Zz3pkW9B3tbUMFbKGbCm 2UkpZ6/bGAEYNbc6wSLZVZGCa6U/09wF+KJY8Mr3EgtHmq+u8pE0pRPVeeQ05QY+lHLq fJvA== |
| X-Gm-Message-State | AOPr4FV54h05TvYryFXo1QaSbGJnxiCIBMEVKZFdv8anv+q+xlZp3P00rRhf0G7hkX41kEZA |
| X-Received | by 10.66.100.197 with SMTP id fa5mr8697789pab.25.1463007790565; Wed, 11 May 2016 16:03:10 -0700 (PDT) |
| X-Mailer | git-send-email 2.8.0.rc3.226.g39d4020 |
| Sender | robomod@news.nic.it |
| List-ID | <linux-kernel.vger.kernel.org> |
| X-Mailing-List | linux-kernel@vger.kernel.org |
| Approved | robomod@news.nic.it |
| Lines | 138 |
| Organization | linux.* mail to news gateway |
| X-Original-Cc | Vikas Shivappa <vikas.shivappa@linux.intel.com>, Matt Fleming <matt@codeblueprint.co.uk>, Tony Luck <tony.luck@intel.com>, Stephane Eranian <eranian@google.com>, Paul Turner <pjt@google.com>, David Carrillo-Cisneros <davidcc@google.com>, x86@kernel.org, linux-kernel@vger.kernel.org |
| X-Original-Date | Wed, 11 May 2016 16:02:26 -0700 |
| X-Original-Message-ID | <1463007752-116802-27-git-send-email-davidcc@google.com> |
| X-Original-References | <1463007752-116802-1-git-send-email-davidcc@google.com> |
| X-Original-Sender | linux-kernel-owner@vger.kernel.org |
| Xref | csiph.com linux.kernel:1399586 |
Show key headers only | View raw
For perf_events, PQR_ASSOC is written twice: in ctx_in and ctx_out.
Since writes to PQR_ASSOC are slow, this has a high impact in context
swich cost.
Modify pqr_common so pqr_update_rmid do not write the msr
right away, but until a call to __pqr_ctx_switch that is called from
the recently introduced finish_arch_pre_lock_switch hook.
Reviewed-by: Stephane Eranian <eranian@google.com>
Signed-off-by: David Carrillo-Cisneros <davidcc@google.com>
---
arch/x86/events/intel/cqm.c | 12 +++++++-----
arch/x86/include/asm/pqr_common.h | 21 ++++++++++++++-------
arch/x86/kernel/cpu/pqr_common.c | 11 ++++++++++-
3 files changed, 31 insertions(+), 13 deletions(-)
diff --git a/arch/x86/events/intel/cqm.c b/arch/x86/events/intel/cqm.c
index 5928bdb..83b041a 100644
--- a/arch/x86/events/intel/cqm.c
+++ b/arch/x86/events/intel/cqm.c
@@ -2515,7 +2515,7 @@ static inline void __intel_cqm_event_start(
if (!(event->hw.state & PERF_HES_STOPPED))
return;
event->hw.state &= ~PERF_HES_STOPPED;
- pqr_update_rmid(summary.sched_rmid, PQR_RMID_MODE_EVENT);
+ pqr_cache_update_rmid(summary.sched_rmid, PQR_RMID_MODE_EVENT);
}
static void intel_cqm_event_start(struct perf_event *event, int mode)
@@ -2545,7 +2545,7 @@ static void intel_cqm_event_stop(struct perf_event *event, int mode)
/* Occupancy of CQM events is obtained at read. No need to read
* when event is stopped since read on inactive cpus succeed.
*/
- pqr_update_rmid(summary.sched_rmid, PQR_RMID_MODE_NOEVENT);
+ pqr_cache_update_rmid(summary.sched_rmid, PQR_RMID_MODE_NOEVENT);
}
static int intel_cqm_event_add(struct perf_event *event, int mode)
@@ -2962,8 +2962,10 @@ static void intel_cqm_cpu_starting(unsigned int cpu)
u16 pkg_id = topology_physical_package_id(cpu);
state->rmid = 0;
- state->rmid_mode = PQR_RMID_MODE_NOEVENT;
+ state->next_rmid = 0;
+ state->next_rmid_mode = PQR_RMID_MODE_NOEVENT;
state->closid = 0;
+ state->next_closid = 0;
/* XXX: lock */
/* XXX: Make sure this case is handled when hotplug happens. */
@@ -3190,12 +3192,12 @@ inline void __intel_cqm_no_event_sched_in(void)
if (WARN_ON_ONCE(!__valid_rmid(pkg_id, summary.sched_rmid)))
goto no_rmid;
- pqr_update_rmid(summary.sched_rmid, PQR_RMID_MODE_NOEVENT);
+ pqr_cache_update_rmid(summary.sched_rmid, PQR_RMID_MODE_NOEVENT);
return;
no_rmid:
summary.value = atomic64_read(&root_pmonr->prmid_summary_atomic);
- pqr_update_rmid(summary.sched_rmid, PQR_RMID_MODE_NOEVENT);
+ pqr_cache_update_rmid(summary.sched_rmid, PQR_RMID_MODE_NOEVENT);
#endif
}
diff --git a/arch/x86/include/asm/pqr_common.h b/arch/x86/include/asm/pqr_common.h
index 0af04d2..bfaa7d8 100644
--- a/arch/x86/include/asm/pqr_common.h
+++ b/arch/x86/include/asm/pqr_common.h
@@ -26,8 +26,10 @@ enum intel_pqr_rmid_mode {
/**
* struct intel_pqr_state - State cache for the PQR MSR
* @rmid: Last RMID written to hw.
+ * @next_rmid: Next RMID to write to hw.
* @rmid_mode: Next RMID's mode.
* @closid: The current Class Of Service ID
+ * @next_closid: The Class Of Service ID to use.
*
* The upper 32 bits of MSR_IA32_PQR_ASSOC contain closid and the
* lower 10 bits rmid. The update to MSR_IA32_PQR_ASSOC always
@@ -39,22 +41,27 @@ enum intel_pqr_rmid_mode {
*/
struct intel_pqr_state {
u32 rmid;
- enum intel_pqr_rmid_mode rmid_mode;
+ u32 next_rmid;
+ enum intel_pqr_rmid_mode next_rmid_mode;
u32 closid;
+ u32 next_closid;
};
DECLARE_PER_CPU(struct intel_pqr_state, pqr_state);
-static inline void pqr_update_rmid(u32 rmid, enum intel_pqr_rmid_mode mode)
+static inline void pqr_cache_update_rmid(u32 rmid, enum intel_pqr_rmid_mode mode)
{
struct intel_pqr_state *state = this_cpu_ptr(&pqr_state);
- state->rmid_mode = mode;
+ state->next_rmid_mode = mode;
+ state->next_rmid = rmid;
+}
+
+static inline void pqr_cache_update_closid(u32 closid)
+{
+ struct intel_pqr_state *state = this_cpu_ptr(&pqr_state);
- if (state->rmid == rmid)
- return;
- state->rmid = rmid;
- wrmsr(MSR_IA32_PQR_ASSOC, rmid, state->closid);
+ state->next_closid = closid;
}
void __pqr_ctx_switch(void);
diff --git a/arch/x86/kernel/cpu/pqr_common.c b/arch/x86/kernel/cpu/pqr_common.c
index e36702f..0ae2b2c 100644
--- a/arch/x86/kernel/cpu/pqr_common.c
+++ b/arch/x86/kernel/cpu/pqr_common.c
@@ -19,6 +19,15 @@ inline void __pqr_ctx_switch(void)
/* If perf_event did set rmid that is used, do not try
* to obtain another one from current task.
*/
- if (state->rmid_mode == PQR_RMID_MODE_NOEVENT)
+ if (state->next_rmid_mode == PQR_RMID_MODE_NOEVENT)
__intel_cqm_no_event_sched_in();
+
+ /* __intel_cqm_no_event_sched_in might have changed next_rmid. */
+ if (state->rmid == state->next_rmid &&
+ state->closid == state->next_closid)
+ return;
+
+ state->rmid = state->next_rmid;
+ state->closid = state->next_closid;
+ wrmsr(MSR_IA32_PQR_ASSOC, state->rmid, state->closid);
}
--
2.8.0.rc3.226.g39d4020
Back to linux.kernel | Previous | Next | Find similar | Unroll thread
[PATCH v2 26/32] perf/x86/intel/cqm: make one write of PQR_ASSOC per ctx switch David Carrillo-Cisneros <davidcc@google.com> - 2016-05-12 01:10 +0200
csiph-web