Series comparison

-[Qemu-devel] [PULL 00/45] target-arm queue
+[PULL 00/54] target-arm queue
-As promised, another pullreq... This one's mostly RTH's patches.
+This is mostly RTH's tcg_constant refactoring work, plus a few
 other things.
 thanks
 -- PMM
-The following changes since commit 784c2e4f232adf5ef47a84a262ec72a07d068d6a:
+The following changes since commit cf6f26d6f9b2015ee12b4604b79359e76784163a:
-  Merge remote-tracking branch 'remotes/jasowang/tags/net-pull-request' into staging (2018-10-19 15:30:40 +0100)
+  Merge tag 'kraxel-20220427-pull-request' of git://git.kraxel.org/qemu into staging (2022-04-27 10:49:28 -0700)
 are available in the Git repository at:
-  https://git.linaro.org/people/pmaydell/qemu-arm.git tags/pull-target-arm-20181019
+  https://git.linaro.org/people/pmaydell/qemu-arm.git tags/pull-target-arm-20220428
-for you to fetch changes up to 88c9add25e7120e8622796c81ad3f3fb7f8d40e7:
+for you to fetch changes up to f8e7163d9e6740b5cef02bf73a17a59d0bef8bdb:
-  target/arm: Only flush tlb if ASID changes (2018-10-19 17:38:48 +0100)
+  hw/arm/smmuv3: Advertise support for SMMUv3.2-BBML2 (2022-04-28 13:59:23 +0100)
 ----------------------------------------------------------------
 target-arm queue:
- * ssi-sd: Make devices picking up backends unavailable with -device
+ * refactor to use tcg_constant where appropriate
- * Add support for VCPU event states
+ * Advertise support for FEAT_TTL and FEAT_BBM level 2
- * Move towards making ID registers the source of truth for
+ * smmuv3: Cache event fault record
-   whether a guest CPU implements a feature, rather than having
+ * smmuv3: Add space in guest error message
-   parallel ID registers and feature bit flags
+ * smmuv3: Advertise support for SMMUv3.2-BBML2
  * Implement various HCR hypervisor trap/config bits
  * Get IL bit correct for v7 syndrome values
  * Report correct syndrome for FP/SIMD traps to Hyp mode
  * hw/arm/boot: Increase compliance with kernel arm64 boot protocol
  * Refactor A32 Neon to use generic vector infrastructure
  * Fix a bug in A32 VLD2 "(multiple 2-element structures)" insn
  * net: cadence_gem: Report features correctly in ID register
  * Avoid some unnecessary TLB flushes on TTBR register writes
 ----------------------------------------------------------------
-Dongjiu Geng (1):
+Damien Hedde (1):
-      target/arm: Add support for VCPU event states
+      target/arm: Disable cryptographic instructions when neon is disabled
-Edgar E. Iglesias (2):
+Jean-Philippe Brucker (2):
-      net: cadence_gem: Announce availability of priority queues
+      hw/arm/smmuv3: Cache event fault record
-      net: cadence_gem: Announce 64bit addressing support
+      hw/arm/smmuv3: Add space in guest error message
-Markus Armbruster (1):
+Peter Maydell (3):
-      ssi-sd: Make devices picking up backends unavailable with -device
+      target/arm: Advertise support for FEAT_TTL
       target/arm: Advertise support for FEAT_BBM level 2
       hw/arm/smmuv3: Advertise support for SMMUv3.2-BBML2
-Peter Maydell (10):
+Richard Henderson (48):
-      target/arm: Improve debug logging of AArch32 exception return
+      target/arm: Use tcg_constant in gen_probe_access
-      target/arm: Make switch_mode() file-local
+      target/arm: Use tcg_constant in gen_mte_check*
-      target/arm: Implement HCR.FB
+      target/arm: Use tcg_constant in gen_exception*
-      target/arm: Implement HCR.DC
+      target/arm: Use tcg_constant in gen_adc_CC
-      target/arm: ISR_EL1 bits track virtual interrupts if IMO/FMO set
+      target/arm: Use tcg_constant in handle_msr_i
-      target/arm: Implement HCR.VI and VF
+      target/arm: Use tcg_constant in handle_sys
-      target/arm: Implement HCR.PTW
+      target/arm: Use tcg_constant in disas_exc
-      target/arm: New utility function to extract EC from syndrome
+      target/arm: Use tcg_constant in gen_compare_and_swap_pair
-      target/arm: Get IL bit correct for v7 syndrome values
+      target/arm: Use tcg_constant in disas_ld_lit
-      target/arm: Report correct syndrome for FP/SIMD traps to Hyp mode
+      target/arm: Use tcg_constant in disas_ldst_*
       target/arm: Use tcg_constant in disas_add_sum_imm*
       target/arm: Use tcg_constant in disas_movw_imm
       target/arm: Use tcg_constant in shift_reg_imm
       target/arm: Use tcg_constant in disas_cond_select
       target/arm: Use tcg_constant in handle_{rev16,crc32}
       target/arm: Use tcg_constant in disas_data_proc_2src
       target/arm: Use tcg_constant in disas_fp*
       target/arm: Use tcg_constant in simd shift expanders
       target/arm: Use tcg_constant in simd fp/int conversion
       target/arm: Use tcg_constant in 2misc expanders
       target/arm: Use tcg_constant in balance of translate-a64.c
       target/arm: Use tcg_constant for aa32 exceptions
       target/arm: Use tcg_constant for disas_iwmmxt_insn
       target/arm: Use tcg_constant for gen_{msr,mrs}
       target/arm: Use tcg_constant for vector shift expanders
       target/arm: Use tcg_constant for do_coproc_insn
       target/arm: Use tcg_constant for gen_srs
       target/arm: Use tcg_constant for op_s_{rri,rxi}_rot
       target/arm: Use tcg_constant for MOVW, UMAAL, CRC32
       target/arm: Use tcg_constant for v7m MRS, MSR
       target/arm: Use tcg_constant for TT, SAT, SMMLA
       target/arm: Use tcg_constant in LDM, STM
       target/arm: Use tcg_constant in CLRM, DLS, WLS, LE
       target/arm: Use tcg_constant in trans_CPS_v7m
       target/arm: Use tcg_constant in trans_CSEL
       target/arm: Use tcg_constant for trans_INDEX_*
       target/arm: Use tcg_constant in SINCDEC, INCDEC
       target/arm: Use tcg_constant in FCPY, CPY
       target/arm: Use tcg_constant in {incr, wrap}_last_active
       target/arm: Use tcg_constant in do_clast_scalar
       target/arm: Use tcg_constant in WHILE
       target/arm: Use tcg_constant in LD1, ST1
       target/arm: Use tcg_constant in SUBR
       target/arm: Use tcg_constant in do_zzi_{sat, ool}, do_fp_imm
       target/arm: Use tcg_constant for predicate descriptors
       target/arm: Use tcg_constant for do_brk{2,3}
       target/arm: Use tcg_constant for vector descriptor
       target/arm: Use field names for accessing DBGWCRn
-Richard Henderson (30):
+ docs/system/arm/emulation.rst |   2 +
-      target/arm: Move some system registers into a substructure
+ hw/arm/smmuv3-internal.h      |   2 +-
-      target/arm: V8M should not imply V7VE
+ include/hw/arm/smmu-common.h  |   1 +
-      target/arm: Convert v8 extensions from feature bits to isar tests
+ target/arm/internals.h        |  12 ++
-      target/arm: Convert division from feature bits to isar0 tests
+ hw/arm/smmuv3.c               |  17 +--
-      target/arm: Convert jazelle from feature bit to isar1 test
+ target/arm/cpu.c              |   9 ++
-      target/arm: Convert t32ee from feature bit to isar3 test
+ target/arm/cpu64.c            |   2 +
-      target/arm: Convert sve from feature bit to aa64pfr0 test
+ target/arm/debug_helper.c     |  10 +-
-      target/arm: Convert v8.2-fp16 from feature bit to aa64pfr0 test
+ target/arm/helper.c           |   8 +-
-      target/arm: Hoist address increment for vector memory ops
+ target/arm/kvm64.c            |  14 +-
-      target/arm: Don't call tcg_clear_temp_count
+ target/arm/translate-a64.c    | 301 +++++++++++++-----------------------------
-      target/arm: Use tcg_gen_gvec_dup_i64 for LD[1-4]R
+ target/arm/translate-sve.c    | 202 ++++++++++------------------
-      target/arm: Promote consecutive memory ops for aa64
+ target/arm/translate.c        | 244 ++++++++++++----------------------
-      target/arm: Mark some arrays const
+files changed, 293 insertions(+), 531 deletions(-)
       target/arm: Use gvec for NEON VDUP
       target/arm: Use gvec for NEON VMOV, VMVN, VBIC & VORR (immediate)
       target/arm: Use gvec for NEON_3R_LOGIC insns
       target/arm: Use gvec for NEON_3R_VADD_VSUB insns
       target/arm: Use gvec for NEON_2RM_VMN, NEON_2RM_VNEG
       target/arm: Use gvec for NEON_3R_VMUL
       target/arm: Use gvec for VSHR, VSHL
       target/arm: Use gvec for VSRA
       target/arm: Use gvec for VSRI, VSLI
       target/arm: Use gvec for NEON_3R_VML
       target/arm: Use gvec for NEON_3R_VTST_VCEQ, NEON_3R_VCGT, NEON_3R_VCGE
       target/arm: Use gvec for NEON VLD all lanes
       target/arm: Reorg NEON VLD/VST all elements
       target/arm: Promote consecutive memory ops for aa32
       target/arm: Reorg NEON VLD/VST single element to one lane
       target/arm: Remove writefn from TTBR0_EL3
       target/arm: Only flush tlb if ASID changes
 Stewart Hildebrand (1):
       hw/arm/boot: Increase compliance with kernel arm64 boot protocol
  target/arm/cpu.h            |  227 ++++++-
  target/arm/internals.h      |   45 +-
  target/arm/kvm_arm.h        |   24 +
  target/arm/translate.h      |   21 +
  hw/arm/boot.c               |   18 +
  hw/intc/armv7m_nvic.c       |   12 +-
  hw/net/cadence_gem.c        |    9 +-
  hw/sd/ssi-sd.c              |    2 +
  linux-user/aarch64/signal.c |    4 +-
  linux-user/elfload.c        |   60 +-
  linux-user/syscall.c        |   10 +-
  target/arm/cpu.c            |  242 ++++----
  target/arm/cpu64.c          |  148 +++--
  target/arm/helper.c         |  397 ++++++++----
  target/arm/kvm.c            |   60 ++
  target/arm/kvm32.c          |   13 +
  target/arm/kvm64.c          |   15 +-
  target/arm/machine.c        |   28 +-
  target/arm/op_helper.c      |    2 +-
  target/arm/translate-a64.c  |  715 ++++-----------------
  target/arm/translate.c      | 1451 ++++++++++++++++++++++++++++---------------
 files changed, 2021 insertions(+), 1482 deletions(-)

-[Qemu-devel] [PULL 37/45] target/arm: Use gvec for NEON_3R_VTST_VCEQ, NEON_3R_VCGT, NEON_3R_VCGE
+[PULL 01/54] target/arm: Use tcg_constant in gen_probe_access
 From: Richard Henderson <richard.henderson@linaro.org>
-Move cmtst_op expanders from translate-a64.c.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-17-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-2-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.h     |  2 +
+ target/arm/translate-a64.c | 12 ++++--------
- target/arm/translate-a64.c | 38 ------------------
+file changed, 4 insertions(+), 8 deletions(-)
  target/arm/translate.c     | 81 +++++++++++++++++++++++++++-----------
 files changed, 60 insertions(+), 61 deletions(-)
-diff --git a/target/arm/translate.h b/target/arm/translate.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.h
-+++ b/target/arm/translate.h
-@@ -XXX,XX +XXX,XX @@ extern const GVecGen3 bit_op;
- extern const GVecGen3 bif_op;
- extern const GVecGen3 mla_op[4];
- extern const GVecGen3 mls_op[4];
-+extern const GVecGen3 cmtst_op[4];
- extern const GVecGen2i ssra_op[4];
- extern const GVecGen2i usra_op[4];
- extern const GVecGen2i sri_op[4];
- extern const GVecGen2i sli_op[4];
-+void gen_cmtst_i64(TCGv_i64 d, TCGv_i64 a, TCGv_i64 b);
- /*
-  * Forward to the isar_feature_* tests given a DisasContext pointer.
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_three_reg_diff(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static void gen_address_with_allocation_tag0(TCGv_i64 dst, TCGv_i64 src)
-     }
+ static void gen_probe_access(DisasContext *s, TCGv_i64 ptr,
                               MMUAccessType acc, int log2_size)
  {
 -    TCGv_i32 t_acc = tcg_const_i32(acc);
 -    TCGv_i32 t_idx = tcg_const_i32(get_mem_index(s));
 -    TCGv_i32 t_size = tcg_const_i32(1 << log2_size);
 -
 -    gen_helper_probe_access(cpu_env, ptr, t_acc, t_idx, t_size);
 -    tcg_temp_free_i32(t_acc);
 -    tcg_temp_free_i32(t_idx);
 -    tcg_temp_free_i32(t_size);
 +    gen_helper_probe_access(cpu_env, ptr,
 +                            tcg_constant_i32(acc),
 +                            tcg_constant_i32(get_mem_index(s)),
 +                            tcg_constant_i32(1 << log2_size));
  }
--/* CMTST : test is "if (X & Y != 0)". */
+ /*
 -static void gen_cmtst_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
 -{
 -    tcg_gen_and_i32(d, a, b);
 -    tcg_gen_setcondi_i32(TCG_COND_NE, d, d, 0);
 -    tcg_gen_neg_i32(d, d);
 -}
 -
 -static void gen_cmtst_i64(TCGv_i64 d, TCGv_i64 a, TCGv_i64 b)
 -{
 -    tcg_gen_and_i64(d, a, b);
 -    tcg_gen_setcondi_i64(TCG_COND_NE, d, d, 0);
 -    tcg_gen_neg_i64(d, d);
 -}
 -
 -static void gen_cmtst_vec(unsigned vece, TCGv_vec d, TCGv_vec a, TCGv_vec b)
 -{
 -    tcg_gen_and_vec(vece, d, a, b);
 -    tcg_gen_dupi_vec(vece, a, 0);
 -    tcg_gen_cmp_vec(TCG_COND_NE, vece, d, d, a);
 -}
 -
  static void handle_3same_64(DisasContext *s, int opcode, bool u,
                              TCGv_i64 tcg_rd, TCGv_i64 tcg_rn, TCGv_i64 tcg_rm)
  {
@@ -XXX,XX +XXX,XX @@ static void disas_simd_3same_float(DisasContext *s, uint32_t insn)
  /* Integer op subgroup of C3.6.16. */
  static void disas_simd_3same_int(DisasContext *s, uint32_t insn)
  {
 -    static const GVecGen3 cmtst_op[4] = {
 -        { .fni4 = gen_helper_neon_tst_u8,
 -          .fniv = gen_cmtst_vec,
 -          .vece = MO_8 },
 -        { .fni4 = gen_helper_neon_tst_u16,
 -          .fniv = gen_cmtst_vec,
 -          .vece = MO_16 },
 -        { .fni4 = gen_cmtst_i32,
 -          .fniv = gen_cmtst_vec,
 -          .vece = MO_32 },
 -        { .fni8 = gen_cmtst_i64,
 -          .fniv = gen_cmtst_vec,
 -          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -          .vece = MO_64 },
 -    };
 -
      int is_q = extract32(insn, 30, 1);
      int u = extract32(insn, 29, 1);
      int size = extract32(insn, 22, 2);
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ const GVecGen3 mls_op[4] = {
        .vece = MO_64 },
  };
 +/* CMTST : test is "if (X & Y != 0)". */
 +static void gen_cmtst_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
 +{
 +    tcg_gen_and_i32(d, a, b);
 +    tcg_gen_setcondi_i32(TCG_COND_NE, d, d, 0);
 +    tcg_gen_neg_i32(d, d);
 +}
 +
 +void gen_cmtst_i64(TCGv_i64 d, TCGv_i64 a, TCGv_i64 b)
 +{
 +    tcg_gen_and_i64(d, a, b);
 +    tcg_gen_setcondi_i64(TCG_COND_NE, d, d, 0);
 +    tcg_gen_neg_i64(d, d);
 +}
 +
 +static void gen_cmtst_vec(unsigned vece, TCGv_vec d, TCGv_vec a, TCGv_vec b)
 +{
 +    tcg_gen_and_vec(vece, d, a, b);
 +    tcg_gen_dupi_vec(vece, a, 0);
 +    tcg_gen_cmp_vec(TCG_COND_NE, vece, d, d, a);
 +}
 +
 +const GVecGen3 cmtst_op[4] = {
 +    { .fni4 = gen_helper_neon_tst_u8,
 +      .fniv = gen_cmtst_vec,
 +      .vece = MO_8 },
 +    { .fni4 = gen_helper_neon_tst_u16,
 +      .fniv = gen_cmtst_vec,
 +      .vece = MO_16 },
 +    { .fni4 = gen_cmtst_i32,
 +      .fniv = gen_cmtst_vec,
 +      .vece = MO_32 },
 +    { .fni8 = gen_cmtst_i64,
 +      .fniv = gen_cmtst_vec,
 +      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 +      .vece = MO_64 },
 +};
 +
  /* Translate a NEON data processing instruction.  Return nonzero if the
     instruction is invalid.
     We process data in a mixture of 32-bit and 64-bit chunks.
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
              tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs, vec_size, vec_size,
                             u ? &mls_op[size] : &mla_op[size]);
              return 0;
 +
 +        case NEON_3R_VTST_VCEQ:
 +            if (u) { /* VCEQ */
 +                tcg_gen_gvec_cmp(TCG_COND_EQ, size, rd_ofs, rn_ofs, rm_ofs,
 +                                 vec_size, vec_size);
 +            } else { /* VTST */
 +                tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs,
 +                               vec_size, vec_size, &cmtst_op[size]);
 +            }
 +            return 0;
 +
 +        case NEON_3R_VCGT:
 +            tcg_gen_gvec_cmp(u ? TCG_COND_GTU : TCG_COND_GT, size,
 +                             rd_ofs, rn_ofs, rm_ofs, vec_size, vec_size);
 +            return 0;
 +
 +        case NEON_3R_VCGE:
 +            tcg_gen_gvec_cmp(u ? TCG_COND_GEU : TCG_COND_GE, size,
 +                             rd_ofs, rn_ofs, rm_ofs, vec_size, vec_size);
 +            return 0;
          }
          if (size == 3) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
          case NEON_3R_VQSUB:
              GEN_NEON_INTEGER_OP_ENV(qsub);
              break;
 -        case NEON_3R_VCGT:
 -            GEN_NEON_INTEGER_OP(cgt);
 -            break;
 -        case NEON_3R_VCGE:
 -            GEN_NEON_INTEGER_OP(cge);
 -            break;
          case NEON_3R_VSHL:
              GEN_NEON_INTEGER_OP(shl);
              break;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
              tmp2 = neon_load_reg(rd, pass);
              gen_neon_add(size, tmp, tmp2);
              break;
 -        case NEON_3R_VTST_VCEQ:
 -            if (!u) { /* VTST */
 -                switch (size) {
 -                case 0: gen_helper_neon_tst_u8(tmp, tmp, tmp2); break;
 -                case 1: gen_helper_neon_tst_u16(tmp, tmp, tmp2); break;
 -                case 2: gen_helper_neon_tst_u32(tmp, tmp, tmp2); break;
 -                default: abort();
 -                }
 -            } else { /* VCEQ */
 -                switch (size) {
 -                case 0: gen_helper_neon_ceq_u8(tmp, tmp, tmp2); break;
 -                case 1: gen_helper_neon_ceq_u16(tmp, tmp, tmp2); break;
 -                case 2: gen_helper_neon_ceq_u32(tmp, tmp, tmp2); break;
 -                default: abort();
 -                }
 -            }
 -            break;
          case NEON_3R_VMUL:
              /* VMUL.P8; other cases already eliminated.  */
              gen_helper_neon_mul_p8(tmp, tmp, tmp2);
 --
-.19.1
+.25.1

-New patch
+[PULL 02/54] target/arm: Use tcg_constant in gen_mte_check*
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-3-richard.henderson@linaro.org
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-a64.c | 10 ++--------
+file changed, 2 insertions(+), 8 deletions(-)
+diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-a64.c
++++ b/target/arm/translate-a64.c
+@@ -XXX,XX +XXX,XX @@ static TCGv_i64 gen_mte_check1_mmuidx(DisasContext *s, TCGv_i64 addr,
+                                       int core_idx)
+ {
+     if (tag_checked && s->mte_active[is_unpriv]) {
+-        TCGv_i32 tcg_desc;
+         TCGv_i64 ret;
+         int desc = 0;
+@@ -XXX,XX +XXX,XX @@ static TCGv_i64 gen_mte_check1_mmuidx(DisasContext *s, TCGv_i64 addr,
+         desc = FIELD_DP32(desc, MTEDESC, TCMA, s->tcma);
+         desc = FIELD_DP32(desc, MTEDESC, WRITE, is_write);
+         desc = FIELD_DP32(desc, MTEDESC, SIZEM1, (1 << log2_size) - 1);
+-        tcg_desc = tcg_const_i32(desc);
+         ret = new_tmp_a64(s);
+-        gen_helper_mte_check(ret, cpu_env, tcg_desc, addr);
+-        tcg_temp_free_i32(tcg_desc);
++        gen_helper_mte_check(ret, cpu_env, tcg_constant_i32(desc), addr);
+         return ret;
+     }
+@@ -XXX,XX +XXX,XX @@ TCGv_i64 gen_mte_checkN(DisasContext *s, TCGv_i64 addr, bool is_write,
+                         bool tag_checked, int size)
+ {
+     if (tag_checked && s->mte_active[0]) {
+-        TCGv_i32 tcg_desc;
+         TCGv_i64 ret;
+         int desc = 0;
+@@ -XXX,XX +XXX,XX @@ TCGv_i64 gen_mte_checkN(DisasContext *s, TCGv_i64 addr, bool is_write,
+         desc = FIELD_DP32(desc, MTEDESC, TCMA, s->tcma);
+         desc = FIELD_DP32(desc, MTEDESC, WRITE, is_write);
+         desc = FIELD_DP32(desc, MTEDESC, SIZEM1, size - 1);
+-        tcg_desc = tcg_const_i32(desc);
+         ret = new_tmp_a64(s);
+-        gen_helper_mte_check(ret, cpu_env, tcg_desc, addr);
+-        tcg_temp_free_i32(tcg_desc);
++        gen_helper_mte_check(ret, cpu_env, tcg_constant_i32(desc), addr);
+         return ret;
+     }
+--
+.25.1

-[Qemu-devel] [PULL 35/45] target/arm: Use gvec for VSRI, VSLI
+[PULL 03/54] target/arm: Use tcg_constant in gen_exception*
 From: Richard Henderson <richard.henderson@linaro.org>
-Move shi_op and sli_op expanders from translate-a64.c.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-15-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-4-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.h     |   2 +
+ target/arm/translate-a64.c | 11 ++---------
- target/arm/translate-a64.c | 152 +----------------------
+file changed, 2 insertions(+), 9 deletions(-)
  target/arm/translate.c     | 244 ++++++++++++++++++++++++++-----------
 files changed, 179 insertions(+), 219 deletions(-)
-diff --git a/target/arm/translate.h b/target/arm/translate.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.h
-+++ b/target/arm/translate.h
-@@ -XXX,XX +XXX,XX @@ extern const GVecGen3 bit_op;
- extern const GVecGen3 bif_op;
- extern const GVecGen2i ssra_op[4];
- extern const GVecGen2i usra_op[4];
-+extern const GVecGen2i sri_op[4];
-+extern const GVecGen2i sli_op[4];
- /*
-  * Forward to the isar_feature_* tests given a DisasContext pointer.
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_two_reg_misc(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static void gen_rebuild_hflags(DisasContext *s)
-     }
  static void gen_exception_internal(int excp)
  {
 -    TCGv_i32 tcg_excp = tcg_const_i32(excp);
 -
      assert(excp_is_internal(excp));
 -    gen_helper_exception_internal(cpu_env, tcg_excp);
 -    tcg_temp_free_i32(tcg_excp);
 +    gen_helper_exception_internal(cpu_env, tcg_constant_i32(excp));
  }
--static void gen_shr8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+ static void gen_exception_internal_insn(DisasContext *s, uint64_t pc, int excp)
--{
+@@ -XXX,XX +XXX,XX @@ static void gen_exception_internal_insn(DisasContext *s, uint64_t pc, int excp)
--    uint64_t mask = dup_const(MO_8, 0xff >> shift);
--    TCGv_i64 t = tcg_temp_new_i64();
+ static void gen_exception_bkpt_insn(DisasContext *s, uint32_t syndrome)
  {
 -    TCGv_i32 tcg_syn;
 -
--    tcg_gen_shri_i64(t, a, shift);
+     gen_a64_set_pc_im(s->pc_curr);
--    tcg_gen_andi_i64(t, t, mask);
+-    tcg_syn = tcg_const_i32(syndrome);
--    tcg_gen_andi_i64(d, d, ~mask);
+-    gen_helper_exception_bkpt_insn(cpu_env, tcg_syn);
--    tcg_gen_or_i64(d, d, t);
+-    tcg_temp_free_i32(tcg_syn);
--    tcg_temp_free_i64(t);
++    gen_helper_exception_bkpt_insn(cpu_env, tcg_constant_i32(syndrome));
--}
+     s->base.is_jmp = DISAS_NORETURN;
 -
 -static void gen_shr16_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 -{
 -    uint64_t mask = dup_const(MO_16, 0xffff >> shift);
 -    TCGv_i64 t = tcg_temp_new_i64();
 -
 -    tcg_gen_shri_i64(t, a, shift);
 -    tcg_gen_andi_i64(t, t, mask);
 -    tcg_gen_andi_i64(d, d, ~mask);
 -    tcg_gen_or_i64(d, d, t);
 -    tcg_temp_free_i64(t);
 -}
 -
 -static void gen_shr32_ins_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
 -{
 -    tcg_gen_shri_i32(a, a, shift);
 -    tcg_gen_deposit_i32(d, d, a, 0, 32 - shift);
 -}
 -
 -static void gen_shr64_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 -{
 -    tcg_gen_shri_i64(a, a, shift);
 -    tcg_gen_deposit_i64(d, d, a, 0, 64 - shift);
 -}
 -
 -static void gen_shr_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
 -{
 -    uint64_t mask = (2ull << ((8 << vece) - 1)) - 1;
 -    TCGv_vec t = tcg_temp_new_vec_matching(d);
 -    TCGv_vec m = tcg_temp_new_vec_matching(d);
 -
 -    tcg_gen_dupi_vec(vece, m, mask ^ (mask >> sh));
 -    tcg_gen_shri_vec(vece, t, a, sh);
 -    tcg_gen_and_vec(vece, d, d, m);
 -    tcg_gen_or_vec(vece, d, d, t);
 -
 -    tcg_temp_free_vec(t);
 -    tcg_temp_free_vec(m);
 -}
 -
  /* SSHR[RA]/USHR[RA] - Vector shift right (optional rounding/accumulate) */
  static void handle_vec_simd_shri(DisasContext *s, bool is_q, bool is_u,
                                   int immh, int immb, int opcode, int rn, int rd)
  {
 -    static const GVecGen2i sri_op[4] = {
 -        { .fni8 = gen_shr8_ins_i64,
 -          .fniv = gen_shr_ins_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_shri_vec,
 -          .vece = MO_8 },
 -        { .fni8 = gen_shr16_ins_i64,
 -          .fniv = gen_shr_ins_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_shri_vec,
 -          .vece = MO_16 },
 -        { .fni4 = gen_shr32_ins_i32,
 -          .fniv = gen_shr_ins_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_shri_vec,
 -          .vece = MO_32 },
 -        { .fni8 = gen_shr64_ins_i64,
 -          .fniv = gen_shr_ins_vec,
 -          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -          .load_dest = true,
 -          .opc = INDEX_op_shri_vec,
 -          .vece = MO_64 },
 -    };
 -
      int size = 32 - clz32(immh) - 1;
      int immhb = immh << 3 | immb;
      int shift = 2 * (8 << size) - immhb;
@@ -XXX,XX +XXX,XX @@ static void handle_vec_simd_shri(DisasContext *s, bool is_q, bool is_u,
      clear_vec_high(s, is_q, rd);
  }
--static void gen_shl8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
--{
--    uint64_t mask = dup_const(MO_8, 0xff << shift);
--    TCGv_i64 t = tcg_temp_new_i64();
--
--    tcg_gen_shli_i64(t, a, shift);
--    tcg_gen_andi_i64(t, t, mask);
--    tcg_gen_andi_i64(d, d, ~mask);
--    tcg_gen_or_i64(d, d, t);
--    tcg_temp_free_i64(t);
--}
--
--static void gen_shl16_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
--{
--    uint64_t mask = dup_const(MO_16, 0xffff << shift);
--    TCGv_i64 t = tcg_temp_new_i64();
--
--    tcg_gen_shli_i64(t, a, shift);
--    tcg_gen_andi_i64(t, t, mask);
--    tcg_gen_andi_i64(d, d, ~mask);
--    tcg_gen_or_i64(d, d, t);
--    tcg_temp_free_i64(t);
--}
--
--static void gen_shl32_ins_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
--{
--    tcg_gen_deposit_i32(d, d, a, shift, 32 - shift);
--}
--
--static void gen_shl64_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
--{
--    tcg_gen_deposit_i64(d, d, a, shift, 64 - shift);
--}
--
--static void gen_shl_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
--{
--    uint64_t mask = (1ull << sh) - 1;
--    TCGv_vec t = tcg_temp_new_vec_matching(d);
--    TCGv_vec m = tcg_temp_new_vec_matching(d);
--
--    tcg_gen_dupi_vec(vece, m, mask);
--    tcg_gen_shli_vec(vece, t, a, sh);
--    tcg_gen_and_vec(vece, d, d, m);
--    tcg_gen_or_vec(vece, d, d, t);
--
--    tcg_temp_free_vec(t);
--    tcg_temp_free_vec(m);
--}
--
- /* SHL/SLI - Vector shift left */
- static void handle_vec_simd_shli(DisasContext *s, bool is_q, bool insert,
-                                  int immh, int immb, int opcode, int rn, int rd)
- {
--    static const GVecGen2i shi_op[4] = {
--        { .fni8 = gen_shl8_ins_i64,
--          .fniv = gen_shl_ins_vec,
--          .opc = INDEX_op_shli_vec,
--          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
--          .load_dest = true,
--          .vece = MO_8 },
--        { .fni8 = gen_shl16_ins_i64,
--          .fniv = gen_shl_ins_vec,
--          .opc = INDEX_op_shli_vec,
--          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
--          .load_dest = true,
--          .vece = MO_16 },
--        { .fni4 = gen_shl32_ins_i32,
--          .fniv = gen_shl_ins_vec,
--          .opc = INDEX_op_shli_vec,
--          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
--          .load_dest = true,
--          .vece = MO_32 },
--        { .fni8 = gen_shl64_ins_i64,
--          .fniv = gen_shl_ins_vec,
--          .opc = INDEX_op_shli_vec,
--          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
--          .load_dest = true,
--          .vece = MO_64 },
--    };
-     int size = 32 - clz32(immh) - 1;
-     int immhb = immh << 3 | immb;
-     int shift = immhb - (8 << size);
-@@ -XXX,XX +XXX,XX @@ static void handle_vec_simd_shli(DisasContext *s, bool is_q, bool insert,
-     }
-     if (insert) {
--        gen_gvec_op2i(s, is_q, rd, rn, shift, &shi_op[size]);
-+        gen_gvec_op2i(s, is_q, rd, rn, shift, &sli_op[size]);
-     } else {
-         gen_gvec_fn2i(s, is_q, rd, rn, shift, tcg_gen_gvec_shli, size);
-     }
-diff --git a/target/arm/translate.c b/target/arm/translate.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
-+++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ const GVecGen2i usra_op[4] = {
-       .vece = MO_64, },
- };
-+static void gen_shr8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-+{
-+    uint64_t mask = dup_const(MO_8, 0xff >> shift);
-+    TCGv_i64 t = tcg_temp_new_i64();
-+
-+    tcg_gen_shri_i64(t, a, shift);
-+    tcg_gen_andi_i64(t, t, mask);
-+    tcg_gen_andi_i64(d, d, ~mask);
-+    tcg_gen_or_i64(d, d, t);
-+    tcg_temp_free_i64(t);
-+}
-+
-+static void gen_shr16_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-+{
-+    uint64_t mask = dup_const(MO_16, 0xffff >> shift);
-+    TCGv_i64 t = tcg_temp_new_i64();
-+
-+    tcg_gen_shri_i64(t, a, shift);
-+    tcg_gen_andi_i64(t, t, mask);
-+    tcg_gen_andi_i64(d, d, ~mask);
-+    tcg_gen_or_i64(d, d, t);
-+    tcg_temp_free_i64(t);
-+}
-+
-+static void gen_shr32_ins_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
-+{
-+    tcg_gen_shri_i32(a, a, shift);
-+    tcg_gen_deposit_i32(d, d, a, 0, 32 - shift);
-+}
-+
-+static void gen_shr64_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-+{
-+    tcg_gen_shri_i64(a, a, shift);
-+    tcg_gen_deposit_i64(d, d, a, 0, 64 - shift);
-+}
-+
-+static void gen_shr_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
-+{
-+    if (sh == 0) {
-+        tcg_gen_mov_vec(d, a);
-+    } else {
-+        TCGv_vec t = tcg_temp_new_vec_matching(d);
-+        TCGv_vec m = tcg_temp_new_vec_matching(d);
-+
-+        tcg_gen_dupi_vec(vece, m, MAKE_64BIT_MASK((8 << vece) - sh, sh));
-+        tcg_gen_shri_vec(vece, t, a, sh);
-+        tcg_gen_and_vec(vece, d, d, m);
-+        tcg_gen_or_vec(vece, d, d, t);
-+
-+        tcg_temp_free_vec(t);
-+        tcg_temp_free_vec(m);
-+    }
-+}
-+
-+const GVecGen2i sri_op[4] = {
-+    { .fni8 = gen_shr8_ins_i64,
-+      .fniv = gen_shr_ins_vec,
-+      .load_dest = true,
-+      .opc = INDEX_op_shri_vec,
-+      .vece = MO_8 },
-+    { .fni8 = gen_shr16_ins_i64,
-+      .fniv = gen_shr_ins_vec,
-+      .load_dest = true,
-+      .opc = INDEX_op_shri_vec,
-+      .vece = MO_16 },
-+    { .fni4 = gen_shr32_ins_i32,
-+      .fniv = gen_shr_ins_vec,
-+      .load_dest = true,
-+      .opc = INDEX_op_shri_vec,
-+      .vece = MO_32 },
-+    { .fni8 = gen_shr64_ins_i64,
-+      .fniv = gen_shr_ins_vec,
-+      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-+      .load_dest = true,
-+      .opc = INDEX_op_shri_vec,
-+      .vece = MO_64 },
-+};
-+
-+static void gen_shl8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-+{
-+    uint64_t mask = dup_const(MO_8, 0xff << shift);
-+    TCGv_i64 t = tcg_temp_new_i64();
-+
-+    tcg_gen_shli_i64(t, a, shift);
-+    tcg_gen_andi_i64(t, t, mask);
-+    tcg_gen_andi_i64(d, d, ~mask);
-+    tcg_gen_or_i64(d, d, t);
-+    tcg_temp_free_i64(t);
-+}
-+
-+static void gen_shl16_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-+{
-+    uint64_t mask = dup_const(MO_16, 0xffff << shift);
-+    TCGv_i64 t = tcg_temp_new_i64();
-+
-+    tcg_gen_shli_i64(t, a, shift);
-+    tcg_gen_andi_i64(t, t, mask);
-+    tcg_gen_andi_i64(d, d, ~mask);
-+    tcg_gen_or_i64(d, d, t);
-+    tcg_temp_free_i64(t);
-+}
-+
-+static void gen_shl32_ins_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
-+{
-+    tcg_gen_deposit_i32(d, d, a, shift, 32 - shift);
-+}
-+
-+static void gen_shl64_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-+{
-+    tcg_gen_deposit_i64(d, d, a, shift, 64 - shift);
-+}
-+
-+static void gen_shl_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
-+{
-+    if (sh == 0) {
-+        tcg_gen_mov_vec(d, a);
-+    } else {
-+        TCGv_vec t = tcg_temp_new_vec_matching(d);
-+        TCGv_vec m = tcg_temp_new_vec_matching(d);
-+
-+        tcg_gen_dupi_vec(vece, m, MAKE_64BIT_MASK(0, sh));
-+        tcg_gen_shli_vec(vece, t, a, sh);
-+        tcg_gen_and_vec(vece, d, d, m);
-+        tcg_gen_or_vec(vece, d, d, t);
-+
-+        tcg_temp_free_vec(t);
-+        tcg_temp_free_vec(m);
-+    }
-+}
-+
-+const GVecGen2i sli_op[4] = {
-+    { .fni8 = gen_shl8_ins_i64,
-+      .fniv = gen_shl_ins_vec,
-+      .load_dest = true,
-+      .opc = INDEX_op_shli_vec,
-+      .vece = MO_8 },
-+    { .fni8 = gen_shl16_ins_i64,
-+      .fniv = gen_shl_ins_vec,
-+      .load_dest = true,
-+      .opc = INDEX_op_shli_vec,
-+      .vece = MO_16 },
-+    { .fni4 = gen_shl32_ins_i32,
-+      .fniv = gen_shl_ins_vec,
-+      .load_dest = true,
-+      .opc = INDEX_op_shli_vec,
-+      .vece = MO_32 },
-+    { .fni8 = gen_shl64_ins_i64,
-+      .fniv = gen_shl_ins_vec,
-+      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-+      .load_dest = true,
-+      .opc = INDEX_op_shli_vec,
-+      .vece = MO_64 },
-+};
-+
- /* Translate a NEON data processing instruction.  Return nonzero if the
-    instruction is invalid.
-    We process data in a mixture of 32-bit and 64-bit chunks.
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-     int pairwise;
-     int u;
-     int vec_size;
--    uint32_t imm, mask;
-+    uint32_t imm;
-     TCGv_i32 tmp, tmp2, tmp3, tmp4, tmp5;
-     TCGv_ptr ptr1, ptr2, ptr3;
-     TCGv_i64 tmp64;
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                     }
-                     return 0;
-+                case 4: /* VSRI */
-+                    if (!u) {
-+                        return 1;
-+                    }
-+                    /* Right shift comes here negative.  */
-+                    shift = -shift;
-+                    /* Shift out of range leaves destination unchanged.  */
-+                    if (shift < 8 << size) {
-+                        tcg_gen_gvec_2i(rd_ofs, rm_ofs, vec_size, vec_size,
-+                                        shift, &sri_op[size]);
-+                    }
-+                    return 0;
-+
-                 case 5: /* VSHL, VSLI */
--                    if (!u) { /* VSHL */
-+                    if (u) { /* VSLI */
-+                        /* Shift out of range leaves destination unchanged.  */
-+                        if (shift < 8 << size) {
-+                            tcg_gen_gvec_2i(rd_ofs, rm_ofs, vec_size,
-+                                            vec_size, shift, &sli_op[size]);
-+                        }
-+                    } else { /* VSHL */
-                         /* Shifts larger than the element size are
-                          * architecturally valid and results in zero.
-                          */
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                             tcg_gen_gvec_shli(size, rd_ofs, rm_ofs, shift,
-                                               vec_size, vec_size);
-                         }
--                        return 0;
-                     }
--                    break;
-+                    return 0;
-                 }
-                 if (size == 3) {
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                             else
-                                 gen_helper_neon_rshl_s64(cpu_V0, cpu_V0, cpu_V1);
-                             break;
--                        case 4: /* VSRI */
--                        case 5: /* VSHL, VSLI */
--                            gen_helper_neon_shl_u64(cpu_V0, cpu_V0, cpu_V1);
--                            break;
-                         case 6: /* VQSHLU */
-                             gen_helper_neon_qshlu_s64(cpu_V0, cpu_env,
-                                                       cpu_V0, cpu_V1);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                             /* Accumulate.  */
-                             neon_load_reg64(cpu_V1, rd + pass);
-                             tcg_gen_add_i64(cpu_V0, cpu_V0, cpu_V1);
--                        } else if (op == 4 || (op == 5 && u)) {
--                            /* Insert */
--                            neon_load_reg64(cpu_V1, rd + pass);
--                            uint64_t mask;
--                            if (shift < -63 || shift > 63) {
--                                mask = 0;
--                            } else {
--                                if (op == 4) {
--                                    mask = 0xffffffffffffffffull >> -shift;
--                                } else {
--                                    mask = 0xffffffffffffffffull << shift;
--                                }
--                            }
--                            tcg_gen_andi_i64(cpu_V1, cpu_V1, ~mask);
--                            tcg_gen_or_i64(cpu_V0, cpu_V0, cpu_V1);
-                         }
-                         neon_store_reg64(cpu_V0, rd + pass);
-                     } else { /* size < 3 */
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                         case 3: /* VRSRA */
-                             GEN_NEON_INTEGER_OP(rshl);
-                             break;
--                        case 4: /* VSRI */
--                        case 5: /* VSHL, VSLI */
--                            switch (size) {
--                            case 0: gen_helper_neon_shl_u8(tmp, tmp, tmp2); break;
--                            case 1: gen_helper_neon_shl_u16(tmp, tmp, tmp2); break;
--                            case 2: gen_helper_neon_shl_u32(tmp, tmp, tmp2); break;
--                            default: abort();
--                            }
--                            break;
-                         case 6: /* VQSHLU */
-                             switch (size) {
-                             case 0:
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                             tmp2 = neon_load_reg(rd, pass);
-                             gen_neon_add(size, tmp, tmp2);
-                             tcg_temp_free_i32(tmp2);
--                        } else if (op == 4 || (op == 5 && u)) {
--                            /* Insert */
--                            switch (size) {
--                            case 0:
--                                if (op == 4)
--                                    mask = 0xff >> -shift;
--                                else
--                                    mask = (uint8_t)(0xff << shift);
--                                mask |= mask << 8;
--                                mask |= mask << 16;
--                                break;
--                            case 1:
--                                if (op == 4)
--                                    mask = 0xffff >> -shift;
--                                else
--                                    mask = (uint16_t)(0xffff << shift);
--                                mask |= mask << 16;
--                                break;
--                            case 2:
--                                if (shift < -31 || shift > 31) {
--                                    mask = 0;
--                                } else {
--                                    if (op == 4)
--                                        mask = 0xffffffffu >> -shift;
--                                    else
--                                        mask = 0xffffffffu << shift;
--                                }
--                                break;
--                            default:
--                                abort();
--                            }
--                            tmp2 = neon_load_reg(rd, pass);
--                            tcg_gen_andi_i32(tmp, tmp, mask);
--                            tcg_gen_andi_i32(tmp2, tmp2, ~mask);
--                            tcg_gen_or_i32(tmp, tmp, tmp2);
--                            tcg_temp_free_i32(tmp2);
-                         }
-                         neon_store_reg(rd, pass, tmp);
-                     }
 --
-.19.1
+.25.1

-New patch
+[PULL 04/54] target/arm: Use tcg_constant in gen_adc_CC
+From: Richard Henderson <richard.henderson@linaro.org>
+Note that tmp was doing double-duty as zero
+and then later as a temporary in its own right.
+Split the use of 0 to a new variable 'zero'.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-5-richard.henderson@linaro.org
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-a64.c | 26 +++++++++++++-------------
+file changed, 13 insertions(+), 13 deletions(-)
+diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-a64.c
++++ b/target/arm/translate-a64.c
+@@ -XXX,XX +XXX,XX @@ static void gen_adc(int sf, TCGv_i64 dest, TCGv_i64 t0, TCGv_i64 t1)
+ static void gen_adc_CC(int sf, TCGv_i64 dest, TCGv_i64 t0, TCGv_i64 t1)
+ {
+     if (sf) {
+-        TCGv_i64 result, cf_64, vf_64, tmp;
+-        result = tcg_temp_new_i64();
+-        cf_64 = tcg_temp_new_i64();
+-        vf_64 = tcg_temp_new_i64();
+-        tmp = tcg_const_i64(0);
++        TCGv_i64 result = tcg_temp_new_i64();
++        TCGv_i64 cf_64 = tcg_temp_new_i64();
++        TCGv_i64 vf_64 = tcg_temp_new_i64();
++        TCGv_i64 tmp = tcg_temp_new_i64();
++        TCGv_i64 zero = tcg_constant_i64(0);
+         tcg_gen_extu_i32_i64(cf_64, cpu_CF);
+-        tcg_gen_add2_i64(result, cf_64, t0, tmp, cf_64, tmp);
+-        tcg_gen_add2_i64(result, cf_64, result, cf_64, t1, tmp);
++        tcg_gen_add2_i64(result, cf_64, t0, zero, cf_64, zero);
++        tcg_gen_add2_i64(result, cf_64, result, cf_64, t1, zero);
+         tcg_gen_extrl_i64_i32(cpu_CF, cf_64);
+         gen_set_NZ64(result);
+@@ -XXX,XX +XXX,XX @@ static void gen_adc_CC(int sf, TCGv_i64 dest, TCGv_i64 t0, TCGv_i64 t1)
+         tcg_temp_free_i64(cf_64);
+         tcg_temp_free_i64(result);
+     } else {
+-        TCGv_i32 t0_32, t1_32, tmp;
+-        t0_32 = tcg_temp_new_i32();
+-        t1_32 = tcg_temp_new_i32();
+-        tmp = tcg_const_i32(0);
++        TCGv_i32 t0_32 = tcg_temp_new_i32();
++        TCGv_i32 t1_32 = tcg_temp_new_i32();
++        TCGv_i32 tmp = tcg_temp_new_i32();
++        TCGv_i32 zero = tcg_constant_i32(0);
+         tcg_gen_extrl_i64_i32(t0_32, t0);
+         tcg_gen_extrl_i64_i32(t1_32, t1);
+-        tcg_gen_add2_i32(cpu_NF, cpu_CF, t0_32, tmp, cpu_CF, tmp);
+-        tcg_gen_add2_i32(cpu_NF, cpu_CF, cpu_NF, cpu_CF, t1_32, tmp);
++        tcg_gen_add2_i32(cpu_NF, cpu_CF, t0_32, zero, cpu_CF, zero);
++        tcg_gen_add2_i32(cpu_NF, cpu_CF, cpu_NF, cpu_CF, t1_32, zero);
+         tcg_gen_mov_i32(cpu_ZF, cpu_NF);
+         tcg_gen_xor_i32(cpu_VF, cpu_NF, t0_32);
+--
+.25.1

-[Qemu-devel] [PULL 09/45] target/arm: Convert sve from feature bit to aa64pfr0 test
+[PULL 05/54] target/arm: Use tcg_constant in handle_msr_i
 From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181016223115.24100-8-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-6-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.h            | 16 +++++++++++++++-
+ target/arm/translate-a64.c | 13 +++----------
- linux-user/aarch64/signal.c |  4 ++--
+file changed, 3 insertions(+), 10 deletions(-)
  linux-user/elfload.c        |  2 +-
  linux-user/syscall.c        | 10 ++++++----
  target/arm/cpu64.c          |  5 ++++-
  target/arm/helper.c         |  9 ++++++---
  target/arm/machine.c        |  3 +--
  target/arm/translate-a64.c  |  4 ++--
 files changed, 37 insertions(+), 16 deletions(-)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
-+++ b/target/arm/cpu.h
-@@ -XXX,XX +XXX,XX @@ FIELD(ID_AA64ISAR1, FRINTTS, 32, 4)
- FIELD(ID_AA64ISAR1, SB, 36, 4)
- FIELD(ID_AA64ISAR1, SPECRES, 40, 4)
-+FIELD(ID_AA64PFR0, EL0, 0, 4)
-+FIELD(ID_AA64PFR0, EL1, 4, 4)
-+FIELD(ID_AA64PFR0, EL2, 8, 4)
-+FIELD(ID_AA64PFR0, EL3, 12, 4)
-+FIELD(ID_AA64PFR0, FP, 16, 4)
-+FIELD(ID_AA64PFR0, ADVSIMD, 20, 4)
-+FIELD(ID_AA64PFR0, GIC, 24, 4)
-+FIELD(ID_AA64PFR0, RAS, 28, 4)
-+FIELD(ID_AA64PFR0, SVE, 32, 4)
-+
- QEMU_BUILD_BUG_ON(ARRAY_SIZE(((ARMCPU *)0)->ccsidr) <= R_V7M_CSSELR_INDEX_MASK);
- /* If adding a feature bit which corresponds to a Linux ELF
-@@ -XXX,XX +XXX,XX @@ enum arm_features {
-     ARM_FEATURE_PMU, /* has PMU support */
-     ARM_FEATURE_VBAR, /* has cp15 VBAR */
-     ARM_FEATURE_M_SECURITY, /* M profile Security Extension */
--    ARM_FEATURE_SVE, /* has Scalable Vector Extension */
-     ARM_FEATURE_V8_FP16, /* implements v8.2 half-precision float */
-     ARM_FEATURE_M_MAIN, /* M profile Main Extension */
- };
-@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_aa64_fcma(const ARMISARegisters *id)
-     return FIELD_EX64(id->id_aa64isar1, ID_AA64ISAR1, FCMA) != 0;
- }
-+static inline bool isar_feature_aa64_sve(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64pfr0, ID_AA64PFR0, SVE) != 0;
-+}
-+
- /*
-  * Forward to the above feature tests given an ARMCPU pointer.
-  */
-diff --git a/linux-user/aarch64/signal.c b/linux-user/aarch64/signal.c
-index XXXXXXX..XXXXXXX 100644
---- a/linux-user/aarch64/signal.c
-+++ b/linux-user/aarch64/signal.c
-@@ -XXX,XX +XXX,XX @@ static int target_restore_sigframe(CPUARMState *env,
-             break;
-         case TARGET_SVE_MAGIC:
--            if (arm_feature(env, ARM_FEATURE_SVE)) {
-+            if (cpu_isar_feature(aa64_sve, arm_env_get_cpu(env))) {
-                 vq = (env->vfp.zcr_el[1] & 0xf) + 1;
-                 sve_size = QEMU_ALIGN_UP(TARGET_SVE_SIG_CONTEXT_SIZE(vq), 16);
-                 if (!sve && size == sve_size) {
-@@ -XXX,XX +XXX,XX @@ static void target_setup_frame(int usig, struct target_sigaction *ka,
-                                       &layout);
-     /* SVE state needs saving only if it exists.  */
--    if (arm_feature(env, ARM_FEATURE_SVE)) {
-+    if (cpu_isar_feature(aa64_sve, arm_env_get_cpu(env))) {
-         vq = (env->vfp.zcr_el[1] & 0xf) + 1;
-         sve_size = QEMU_ALIGN_UP(TARGET_SVE_SIG_CONTEXT_SIZE(vq), 16);
-         sve_ofs = alloc_sigframe_space(sve_size, &layout);
-diff --git a/linux-user/elfload.c b/linux-user/elfload.c
-index XXXXXXX..XXXXXXX 100644
---- a/linux-user/elfload.c
-+++ b/linux-user/elfload.c
-@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
-     GET_FEATURE_ID(aa64_rdm, ARM_HWCAP_A64_ASIMDRDM);
-     GET_FEATURE_ID(aa64_dp, ARM_HWCAP_A64_ASIMDDP);
-     GET_FEATURE_ID(aa64_fcma, ARM_HWCAP_A64_FCMA);
--    GET_FEATURE(ARM_FEATURE_SVE, ARM_HWCAP_A64_SVE);
-+    GET_FEATURE_ID(aa64_sve, ARM_HWCAP_A64_SVE);
- #undef GET_FEATURE
- #undef GET_FEATURE_ID
-diff --git a/linux-user/syscall.c b/linux-user/syscall.c
-index XXXXXXX..XXXXXXX 100644
---- a/linux-user/syscall.c
-+++ b/linux-user/syscall.c
-@@ -XXX,XX +XXX,XX @@ static abi_long do_syscall1(void *cpu_env, int num, abi_long arg1,
-              * even though the current architectural maximum is VQ=16.
-              */
-             ret = -TARGET_EINVAL;
--            if (arm_feature(cpu_env, ARM_FEATURE_SVE)
-+            if (cpu_isar_feature(aa64_sve, arm_env_get_cpu(cpu_env))
-                 && arg2 >= 0 && arg2 <= 512 * 16 && !(arg2 & 15)) {
-                 CPUARMState *env = cpu_env;
-                 ARMCPU *cpu = arm_env_get_cpu(env);
-@@ -XXX,XX +XXX,XX @@ static abi_long do_syscall1(void *cpu_env, int num, abi_long arg1,
-             return ret;
-         case TARGET_PR_SVE_GET_VL:
-             ret = -TARGET_EINVAL;
--            if (arm_feature(cpu_env, ARM_FEATURE_SVE)) {
--                CPUARMState *env = cpu_env;
--                ret = ((env->vfp.zcr_el[1] & 0xf) + 1) * 16;
-+            {
-+                ARMCPU *cpu = arm_env_get_cpu(cpu_env);
-+                if (cpu_isar_feature(aa64_sve, cpu)) {
-+                    ret = ((cpu->env.vfp.zcr_el[1] & 0xf) + 1) * 16;
-+                }
-             }
-             return ret;
- #endif /* AARCH64 */
-diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu64.c
-+++ b/target/arm/cpu64.c
-@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
-         t = FIELD_DP64(t, ID_AA64ISAR1, FCMA, 1);
-         cpu->isar.id_aa64isar1 = t;
-+        t = cpu->isar.id_aa64pfr0;
-+        t = FIELD_DP64(t, ID_AA64PFR0, SVE, 1);
-+        cpu->isar.id_aa64pfr0 = t;
-+
-         /* Replicate the same data to the 32-bit id registers.  */
-         u = cpu->isar.id_isar5;
-         u = FIELD_DP32(u, ID_ISAR5, AES, 2); /* AES + PMULL */
-@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
-          * present in either.
-          */
-         set_feature(&cpu->env, ARM_FEATURE_V8_FP16);
--        set_feature(&cpu->env, ARM_FEATURE_SVE);
-         /* For usermode -cpu max we can use a larger and more efficient DCZ
-          * blocksize since we don't have to follow what the hardware does.
-          */
-diff --git a/target/arm/helper.c b/target/arm/helper.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
-+++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
-         define_one_arm_cp_reg(cpu, &sctlr);
-     }
--    if (arm_feature(env, ARM_FEATURE_SVE)) {
-+    if (cpu_isar_feature(aa64_sve, cpu)) {
-         define_one_arm_cp_reg(cpu, &zcr_el1_reginfo);
-         if (arm_feature(env, ARM_FEATURE_EL2)) {
-             define_one_arm_cp_reg(cpu, &zcr_el2_reginfo);
-@@ -XXX,XX +XXX,XX @@ void cpu_get_tb_cpu_state(CPUARMState *env, target_ulong *pc,
-     uint32_t flags;
-     if (is_a64(env)) {
-+        ARMCPU *cpu = arm_env_get_cpu(env);
-+
-         *pc = env->pc;
-         flags = ARM_TBFLAG_AARCH64_STATE_MASK;
-         /* Get control bits for tagged addresses */
-         flags |= (arm_regime_tbi0(env, mmu_idx) << ARM_TBFLAG_TBI0_SHIFT);
-         flags |= (arm_regime_tbi1(env, mmu_idx) << ARM_TBFLAG_TBI1_SHIFT);
--        if (arm_feature(env, ARM_FEATURE_SVE)) {
-+        if (cpu_isar_feature(aa64_sve, cpu)) {
-             int sve_el = sve_exception_el(env, current_el);
-             uint32_t zcr_len;
-@@ -XXX,XX +XXX,XX @@ void aarch64_sve_narrow_vq(CPUARMState *env, unsigned vq)
- void aarch64_sve_change_el(CPUARMState *env, int old_el,
-                            int new_el, bool el0_a64)
- {
-+    ARMCPU *cpu = arm_env_get_cpu(env);
-     int old_len, new_len;
-     bool old_a64, new_a64;
-     /* Nothing to do if no SVE.  */
--    if (!arm_feature(env, ARM_FEATURE_SVE)) {
-+    if (!cpu_isar_feature(aa64_sve, cpu)) {
-         return;
-     }
-diff --git a/target/arm/machine.c b/target/arm/machine.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/machine.c
-+++ b/target/arm/machine.c
-@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_iwmmxt = {
- static bool sve_needed(void *opaque)
- {
-     ARMCPU *cpu = opaque;
--    CPUARMState *env = &cpu->env;
--    return arm_feature(env, ARM_FEATURE_SVE);
-+    return cpu_isar_feature(aa64_sve, cpu);
- }
- /* The first two words of each Zreg is stored in VFP state.  */
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
-@@ -XXX,XX +XXX,XX @@ void aarch64_cpu_dump_state(CPUState *cs, FILE *f,
+@@ -XXX,XX +XXX,XX @@ static void gen_axflag(void)
-     cpu_fprintf(f, "     FPCR=%08x FPSR=%08x\n",
+ static void handle_msr_i(DisasContext *s, uint32_t insn,
-                 vfp_get_fpcr(env), vfp_get_fpsr(env));
+                          unsigned int op1, unsigned int op2, unsigned int crm)
+ {
--    if (arm_feature(env, ARM_FEATURE_SVE) && sve_exception_el(env, el) == 0) {
+-    TCGv_i32 t1;
-+    if (cpu_isar_feature(aa64_sve, cpu) && sve_exception_el(env, el) == 0) {
+     int op = op1 << 3 | op2;
-         int j, zcr_len = sve_zcr_len_for_el(env, el);
+     /* End the TB by default, chaining is ok.  */
-         for (i = 0; i <= FFR_PRED_NUM; i++) {
+@@ -XXX,XX +XXX,XX @@ static void handle_msr_i(DisasContext *s, uint32_t insn,
-@@ -XXX,XX +XXX,XX @@ static void disas_a64_insn(CPUARMState *env, DisasContext *s)
+         if (s->current_el == 0) {
-         unallocated_encoding(s);
+             goto do_unallocated;
          }
 -        t1 = tcg_const_i32(crm & PSTATE_SP);
 -        gen_helper_msr_i_spsel(cpu_env, t1);
 -        tcg_temp_free_i32(t1);
 +        gen_helper_msr_i_spsel(cpu_env, tcg_constant_i32(crm & PSTATE_SP));
          break;
-     case 0x2:
--        if (!arm_dc_feature(s, ARM_FEATURE_SVE) || !disas_sve(s, insn)) {
+     case 0x19: /* SSBS */
-+        if (!dc_isar_feature(aa64_sve, s) || !disas_sve(s, insn)) {
+@@ -XXX,XX +XXX,XX @@ static void handle_msr_i(DisasContext *s, uint32_t insn,
-             unallocated_encoding(s);
+         break;
-         }
      case 0x1e: /* DAIFSet */
 -        t1 = tcg_const_i32(crm);
 -        gen_helper_msr_i_daifset(cpu_env, t1);
 -        tcg_temp_free_i32(t1);
 +        gen_helper_msr_i_daifset(cpu_env, tcg_constant_i32(crm));
          break;
      case 0x1f: /* DAIFClear */
 -        t1 = tcg_const_i32(crm);
 -        gen_helper_msr_i_daifclear(cpu_env, t1);
 -        tcg_temp_free_i32(t1);
 +        gen_helper_msr_i_daifclear(cpu_env, tcg_constant_i32(crm));
          /* For DAIFClear, exit the cpu loop to re-evaluate pending IRQs.  */
          s->base.is_jmp = DISAS_UPDATE_EXIT;
          break;
 --
-.19.1
+.25.1

-New patch
+[PULL 06/54] target/arm: Use tcg_constant in handle_sys
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-7-richard.henderson@linaro.org
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-a64.c | 31 +++++++++----------------------
+file changed, 9 insertions(+), 22 deletions(-)
+diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-a64.c
++++ b/target/arm/translate-a64.c
+@@ -XXX,XX +XXX,XX @@ static void handle_sys(DisasContext *s, uint32_t insn, bool isread,
+         /* Emit code to perform further access permissions checks at
+          * runtime; this may result in an exception.
+          */
+-        TCGv_ptr tmpptr;
+-        TCGv_i32 tcg_syn, tcg_isread;
+         uint32_t syndrome;
+-        gen_a64_set_pc_im(s->pc_curr);
+-        tmpptr = tcg_const_ptr(ri);
+         syndrome = syn_aa64_sysregtrap(op0, op1, op2, crn, crm, rt, isread);
+-        tcg_syn = tcg_const_i32(syndrome);
+-        tcg_isread = tcg_const_i32(isread);
+-        gen_helper_access_check_cp_reg(cpu_env, tmpptr, tcg_syn, tcg_isread);
+-        tcg_temp_free_ptr(tmpptr);
+-        tcg_temp_free_i32(tcg_syn);
+-        tcg_temp_free_i32(tcg_isread);
++        gen_a64_set_pc_im(s->pc_curr);
++        gen_helper_access_check_cp_reg(cpu_env,
++                                       tcg_constant_ptr(ri),
++                                       tcg_constant_i32(syndrome),
++                                       tcg_constant_i32(isread));
+     } else if (ri->type & ARM_CP_RAISES_EXC) {
+         /*
+          * The readfn or writefn might raise an exception;
+@@ -XXX,XX +XXX,XX @@ static void handle_sys(DisasContext *s, uint32_t insn, bool isread,
+     case ARM_CP_DC_ZVA:
+         /* Writes clear the aligned block of memory which rt points into. */
+         if (s->mte_active[0]) {
+-            TCGv_i32 t_desc;
+             int desc = 0;
+             desc = FIELD_DP32(desc, MTEDESC, MIDX, get_mem_index(s));
+             desc = FIELD_DP32(desc, MTEDESC, TBI, s->tbid);
+             desc = FIELD_DP32(desc, MTEDESC, TCMA, s->tcma);
+-            t_desc = tcg_const_i32(desc);
+             tcg_rt = new_tmp_a64(s);
+-            gen_helper_mte_check_zva(tcg_rt, cpu_env, t_desc, cpu_reg(s, rt));
+-            tcg_temp_free_i32(t_desc);
++            gen_helper_mte_check_zva(tcg_rt, cpu_env,
++                                     tcg_constant_i32(desc), cpu_reg(s, rt));
+         } else {
+             tcg_rt = clean_data_tbi(s, cpu_reg(s, rt));
+         }
+@@ -XXX,XX +XXX,XX @@ static void handle_sys(DisasContext *s, uint32_t insn, bool isread,
+         if (ri->type & ARM_CP_CONST) {
+             tcg_gen_movi_i64(tcg_rt, ri->resetvalue);
+         } else if (ri->readfn) {
+-            TCGv_ptr tmpptr;
+-            tmpptr = tcg_const_ptr(ri);
+-            gen_helper_get_cp_reg64(tcg_rt, cpu_env, tmpptr);
+-            tcg_temp_free_ptr(tmpptr);
++            gen_helper_get_cp_reg64(tcg_rt, cpu_env, tcg_constant_ptr(ri));
+         } else {
+             tcg_gen_ld_i64(tcg_rt, cpu_env, ri->fieldoffset);
+         }
+@@ -XXX,XX +XXX,XX @@ static void handle_sys(DisasContext *s, uint32_t insn, bool isread,
+             /* If not forbidden by access permissions, treat as WI */
+             return;
+         } else if (ri->writefn) {
+-            TCGv_ptr tmpptr;
+-            tmpptr = tcg_const_ptr(ri);
+-            gen_helper_set_cp_reg64(cpu_env, tmpptr, tcg_rt);
+-            tcg_temp_free_ptr(tmpptr);
++            gen_helper_set_cp_reg64(cpu_env, tcg_constant_ptr(ri), tcg_rt);
+         } else {
+             tcg_gen_st_i64(tcg_rt, cpu_env, ri->fieldoffset);
+         }
+--
+.25.1

-New patch
+[PULL 07/54] target/arm: Use tcg_constant in disas_exc
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-8-richard.henderson@linaro.org
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-a64.c | 5 +----
+file changed, 1 insertion(+), 4 deletions(-)
+diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-a64.c
++++ b/target/arm/translate-a64.c
+@@ -XXX,XX +XXX,XX @@ static void disas_exc(DisasContext *s, uint32_t insn)
+     int opc = extract32(insn, 21, 3);
+     int op2_ll = extract32(insn, 0, 5);
+     int imm16 = extract32(insn, 5, 16);
+-    TCGv_i32 tmp;
+     switch (opc) {
+     case 0:
+@@ -XXX,XX +XXX,XX @@ static void disas_exc(DisasContext *s, uint32_t insn)
+                 break;
+             }
+             gen_a64_set_pc_im(s->pc_curr);
+-            tmp = tcg_const_i32(syn_aa64_smc(imm16));
+-            gen_helper_pre_smc(cpu_env, tmp);
+-            tcg_temp_free_i32(tmp);
++            gen_helper_pre_smc(cpu_env, tcg_constant_i32(syn_aa64_smc(imm16)));
+             gen_ss_advance(s);
+             gen_exception_insn(s, s->base.pc_next, EXCP_SMC,
+                                syn_aa64_smc(imm16), 3);
+--
+.25.1

-New patch
+[PULL 08/54] target/arm: Use tcg_constant in gen_compare_and_swap_pair
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-9-richard.henderson@linaro.org
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-a64.c | 6 ++----
+file changed, 2 insertions(+), 4 deletions(-)
+diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-a64.c
++++ b/target/arm/translate-a64.c
+@@ -XXX,XX +XXX,XX @@ static void gen_compare_and_swap_pair(DisasContext *s, int rs, int rt,
+         tcg_temp_free_i64(cmp);
+     } else if (tb_cflags(s->base.tb) & CF_PARALLEL) {
+         if (HAVE_CMPXCHG128) {
+-            TCGv_i32 tcg_rs = tcg_const_i32(rs);
++            TCGv_i32 tcg_rs = tcg_constant_i32(rs);
+             if (s->be_data == MO_LE) {
+                 gen_helper_casp_le_parallel(cpu_env, tcg_rs,
+                                             clean_addr, t1, t2);
+@@ -XXX,XX +XXX,XX @@ static void gen_compare_and_swap_pair(DisasContext *s, int rs, int rt,
+                 gen_helper_casp_be_parallel(cpu_env, tcg_rs,
+                                             clean_addr, t1, t2);
+             }
+-            tcg_temp_free_i32(tcg_rs);
+         } else {
+             gen_helper_exit_atomic(cpu_env);
+             s->base.is_jmp = DISAS_NORETURN;
+@@ -XXX,XX +XXX,XX @@ static void gen_compare_and_swap_pair(DisasContext *s, int rs, int rt,
+         TCGv_i64 a2 = tcg_temp_new_i64();
+         TCGv_i64 c1 = tcg_temp_new_i64();
+         TCGv_i64 c2 = tcg_temp_new_i64();
+-        TCGv_i64 zero = tcg_const_i64(0);
++        TCGv_i64 zero = tcg_constant_i64(0);
+         /* Load the two words, in memory order.  */
+         tcg_gen_qemu_ld_i64(d1, clean_addr, memidx,
+@@ -XXX,XX +XXX,XX @@ static void gen_compare_and_swap_pair(DisasContext *s, int rs, int rt,
+         tcg_temp_free_i64(a2);
+         tcg_temp_free_i64(c1);
+         tcg_temp_free_i64(c2);
+-        tcg_temp_free_i64(zero);
+         /* Write back the data from memory to Rs.  */
+         tcg_gen_mov_i64(s1, d1);
+--
+.25.1

-[Qemu-devel] [PULL 01/45] ssi-sd: Make devices picking up backends unavailable with -device
+[PULL 09/54] target/arm: Use tcg_constant in disas_ld_lit
-From: Markus Armbruster <armbru@redhat.com>
+From: Richard Henderson <richard.henderson@linaro.org>
-Device models aren't supposed to go on fishing expeditions for
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-backends.  They should expose suitable properties for the user to set.
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-For onboard devices, board code sets them.
+Message-id: 20220426163043.100432-10-richard.henderson@linaro.org
 Device ssi-sd picks up its block backend in its init() method with
 drive_get_next() instead.  This mistake is already marked FIXME since
 commit af9e40a.
 Unset user_creatable to remove the mistake from our external
 interface.  Since the SSI bus doesn't support hotplug, only -device
 can be affected.  Only certain ARM machines have ssi-sd and provide an
 SSI bus for it; this patch breaks -device ssi-sd for these machines.
 No actual use of -device ssi-sd is known.
 Signed-off-by: Markus Armbruster <armbru@redhat.com>
 Acked-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
 Acked-by: Thomas Huth <thuth@redhat.com>
 Message-id: 20181009060835.4608-1-armbru@redhat.com
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- hw/sd/ssi-sd.c | 2 ++
+ target/arm/translate-a64.c | 3 +--
-file changed, 2 insertions(+)
+file changed, 1 insertion(+), 2 deletions(-)
-diff --git a/hw/sd/ssi-sd.c b/hw/sd/ssi-sd.c
+diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
---- a/hw/sd/ssi-sd.c
+--- a/target/arm/translate-a64.c
-+++ b/hw/sd/ssi-sd.c
++++ b/target/arm/translate-a64.c
-@@ -XXX,XX +XXX,XX @@ static void ssi_sd_class_init(ObjectClass *klass, void *data)
+@@ -XXX,XX +XXX,XX @@ static void disas_ld_lit(DisasContext *s, uint32_t insn)
-     k->cs_polarity = SSI_CS_LOW;
-     dc->vmsd = &vmstate_ssi_sd;
+     tcg_rt = cpu_reg(s, rt);
-     dc->reset = ssi_sd_reset;
-+    /* Reason: init() method uses drive_get_next() */
+-    clean_addr = tcg_const_i64(s->pc_curr + imm);
-+    dc->user_creatable = false;
++    clean_addr = tcg_constant_i64(s->pc_curr + imm);
      if (is_vector) {
          do_fp_ld(s, rt, clean_addr, size);
      } else {
@@ -XXX,XX +XXX,XX @@ static void disas_ld_lit(DisasContext *s, uint32_t insn)
          do_gpr_ld(s, tcg_rt, clean_addr, size + is_signed * MO_SIGN,
                    false, true, rt, iss_sf, false);
      }
 -    tcg_temp_free_i64(clean_addr);
  }
- static const TypeInfo ssi_sd_info = {
+ /*
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 22/45] target/arm: Hoist address increment for vector memory ops
+[PULL 10/54] target/arm: Use tcg_constant in disas_ldst_*
-From: Richard Henderson <rth@twiddle.net>
+From: Richard Henderson <richard.henderson@linaro.org>
-This can reduce the number of opcodes required for certain
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 complex forms of load-multiple (e.g. ld4.16b).
 Signed-off-by: Richard Henderson <rth@twiddle.net>
 Message-id: 20181011205206.3552-2-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-11-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate-a64.c | 12 ++++++++----
+ target/arm/translate-a64.c | 9 +++------
-file changed, 8 insertions(+), 4 deletions(-)
+file changed, 3 insertions(+), 6 deletions(-)
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
 @@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
-     bool is_store = !extract32(insn, 22, 1);
+     mop = endian | size | align;
-     bool is_postidx = extract32(insn, 23, 1);
-     bool is_q = extract32(insn, 30, 1);
+     elements = (is_q ? 16 : 8) >> size;
--    TCGv_i64 tcg_addr, tcg_rn;
+-    tcg_ebytes = tcg_const_i64(1 << size);
-+    TCGv_i64 tcg_addr, tcg_rn, tcg_ebytes;
++    tcg_ebytes = tcg_constant_i64(1 << size);
      int ebytes = 1 << size;
      int elements = (is_q ? 128 : 64) / (8 << size);
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
      tcg_rn = cpu_reg_sp(s, rn);
      tcg_addr = tcg_temp_new_i64();
      tcg_gen_mov_i64(tcg_addr, tcg_rn);
 +    tcg_ebytes = tcg_const_i64(ebytes);
      for (r = 0; r < rpt; r++) {
          int e;
+         for (e = 0; e < elements; e++) {
 @@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
-                         clear_vec_high(s, is_q, tt);
-                     }
-                 }
--                tcg_gen_addi_i64(tcg_addr, tcg_addr, ebytes);
-+                tcg_gen_add_i64(tcg_addr, tcg_addr, tcg_ebytes);
-                 tt = (tt + 1) % 32;
              }
          }
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
-             tcg_gen_add_i64(tcg_rn, tcg_rn, cpu_reg(s, rm));
-         }
      }
-+    tcg_temp_free_i64(tcg_ebytes);
+-    tcg_temp_free_i64(tcg_ebytes);
-     tcg_temp_free_i64(tcg_addr);
- }
+     if (!is_store) {
+         /* For non-quad operations, setting a slice of the low
 @@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
-     bool replicate = false;
+                                 total);
-     int index = is_q << 3 | S << 2 | size;
+     mop = finalize_memop(s, scale);
-     int ebytes, xs;
--    TCGv_i64 tcg_addr, tcg_rn;
+-    tcg_ebytes = tcg_const_i64(1 << scale);
-+    TCGv_i64 tcg_addr, tcg_rn, tcg_ebytes;
++    tcg_ebytes = tcg_constant_i64(1 << scale);
      switch (scale) {
      case 3:
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
      tcg_rn = cpu_reg_sp(s, rn);
      tcg_addr = tcg_temp_new_i64();
      tcg_gen_mov_i64(tcg_addr, tcg_rn);
 +    tcg_ebytes = tcg_const_i64(ebytes);
      for (xs = 0; xs < selem; xs++) {
          if (replicate) {
+             /* Load and replicate to all elements */
 @@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
-                 do_vec_st(s, rt, index, tcg_addr, scale);
+         tcg_gen_add_i64(clean_addr, clean_addr, tcg_ebytes);
              }
          }
 -        tcg_gen_addi_i64(tcg_addr, tcg_addr, ebytes);
 +        tcg_gen_add_i64(tcg_addr, tcg_addr, tcg_ebytes);
          rt = (rt + 1) % 32;
      }
+-    tcg_temp_free_i64(tcg_ebytes);
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
-             tcg_gen_add_i64(tcg_rn, tcg_rn, cpu_reg(s, rm));
+     if (is_postidx) {
          if (rm == 31) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_tag(DisasContext *s, uint32_t insn)
      if (is_zero) {
          TCGv_i64 clean_addr = clean_data_tbi(s, addr);
 -        TCGv_i64 tcg_zero = tcg_const_i64(0);
 +        TCGv_i64 tcg_zero = tcg_constant_i64(0);
          int mem_index = get_mem_index(s);
          int i, n = (1 + is_pair) << LOG2_TAG_GRANULE;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_tag(DisasContext *s, uint32_t insn)
              tcg_gen_addi_i64(clean_addr, clean_addr, 8);
              tcg_gen_qemu_st_i64(tcg_zero, clean_addr, mem_index, MO_UQ);
          }
+-        tcg_temp_free_i64(tcg_zero);
      }
-+    tcg_temp_free_i64(tcg_ebytes);
-     tcg_temp_free_i64(tcg_addr);
+     if (index != 0) {
  }
 --
-.19.1
+.25.1

-New patch
+[PULL 11/54] target/arm: Use tcg_constant in disas_add_sum_imm*
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-12-richard.henderson@linaro.org
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-a64.c | 12 ++++--------
+file changed, 4 insertions(+), 8 deletions(-)
+diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-a64.c
++++ b/target/arm/translate-a64.c
+@@ -XXX,XX +XXX,XX @@ static void disas_add_sub_imm(DisasContext *s, uint32_t insn)
+             tcg_gen_addi_i64(tcg_result, tcg_rn, imm);
+         }
+     } else {
+-        TCGv_i64 tcg_imm = tcg_const_i64(imm);
++        TCGv_i64 tcg_imm = tcg_constant_i64(imm);
+         if (sub_op) {
+             gen_sub_CC(is_64bit, tcg_result, tcg_rn, tcg_imm);
+         } else {
+             gen_add_CC(is_64bit, tcg_result, tcg_rn, tcg_imm);
+         }
+-        tcg_temp_free_i64(tcg_imm);
+     }
+     if (is_64bit) {
+@@ -XXX,XX +XXX,XX @@ static void disas_add_sub_imm_with_tags(DisasContext *s, uint32_t insn)
+     tcg_rd = cpu_reg_sp(s, rd);
+     if (s->ata) {
+-        TCGv_i32 offset = tcg_const_i32(imm);
+-        TCGv_i32 tag_offset = tcg_const_i32(uimm4);
+-
+-        gen_helper_addsubg(tcg_rd, cpu_env, tcg_rn, offset, tag_offset);
+-        tcg_temp_free_i32(tag_offset);
+-        tcg_temp_free_i32(offset);
++        gen_helper_addsubg(tcg_rd, cpu_env, tcg_rn,
++                           tcg_constant_i32(imm),
++                           tcg_constant_i32(uimm4));
+     } else {
+         tcg_gen_addi_i64(tcg_rd, tcg_rn, imm);
+         gen_address_with_allocation_tag0(tcg_rd, tcg_rd);
+--
+.25.1

-[Qemu-devel] [PULL 24/45] target/arm: Use tcg_gen_gvec_dup_i64 for LD[1-4]R
+[PULL 12/54] target/arm: Use tcg_constant in disas_movw_imm
 From: Richard Henderson <richard.henderson@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-4-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-13-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate-a64.c | 28 +++-------------------------
+ target/arm/translate-a64.c | 5 +----
-file changed, 3 insertions(+), 25 deletions(-)
+file changed, 1 insertion(+), 4 deletions(-)
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static void disas_movw_imm(DisasContext *s, uint32_t insn)
-     for (xs = 0; xs < selem; xs++) {
+     int opc = extract32(insn, 29, 2);
-         if (replicate) {
+     int pos = extract32(insn, 21, 2) << 4;
-             /* Load and replicate to all elements */
+     TCGv_i64 tcg_rd = cpu_reg(s, rd);
--            uint64_t mulconst;
+-    TCGv_i64 tcg_imm;
-             TCGv_i64 tcg_tmp = tcg_temp_new_i64();
+     if (!sf && (pos >= 32)) {
-             tcg_gen_qemu_ld_i64(tcg_tmp, tcg_addr,
+         unallocated_encoding(s);
-                                 get_mem_index(s), s->be_data + scale);
+@@ -XXX,XX +XXX,XX @@ static void disas_movw_imm(DisasContext *s, uint32_t insn)
--            switch (scale) {
+         tcg_gen_movi_i64(tcg_rd, imm);
--            case 0:
+         break;
--                mulconst = 0x0101010101010101ULL;
+     case 3: /* MOVK */
--                break;
+-        tcg_imm = tcg_const_i64(imm);
--            case 1:
+-        tcg_gen_deposit_i64(tcg_rd, tcg_rd, tcg_imm, pos, 16);
--                mulconst = 0x0001000100010001ULL;
+-        tcg_temp_free_i64(tcg_imm);
--                break;
++        tcg_gen_deposit_i64(tcg_rd, tcg_rd, tcg_constant_i64(imm), pos, 16);
--            case 2:
+         if (!sf) {
--                mulconst = 0x0000000100000001ULL;
+             tcg_gen_ext32u_i64(tcg_rd, tcg_rd);
--                break;
+         }
 -            case 3:
 -                mulconst = 0;
 -                break;
 -            default:
 -                g_assert_not_reached();
 -            }
 -            if (mulconst) {
 -                tcg_gen_muli_i64(tcg_tmp, tcg_tmp, mulconst);
 -            }
 -            write_vec_element(s, tcg_tmp, rt, 0, MO_64);
 -            if (is_q) {
 -                write_vec_element(s, tcg_tmp, rt, 1, MO_64);
 -            }
 +            tcg_gen_gvec_dup_i64(scale, vec_full_reg_offset(s, rt),
 +                                 (is_q + 1) * 8, vec_full_reg_size(s),
 +                                 tcg_tmp);
              tcg_temp_free_i64(tcg_tmp);
 -            clear_vec_high(s, is_q, rt);
          } else {
              /* Load/store one element per register */
              if (is_load) {
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 36/45] target/arm: Use gvec for NEON_3R_VML
+[PULL 13/54] target/arm: Use tcg_constant in shift_reg_imm
 From: Richard Henderson <richard.henderson@linaro.org>
-Move mla_op and mls_op expanders from translate-a64.c.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-16-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-14-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.h     |   2 +
+ target/arm/translate-a64.c | 6 +-----
- target/arm/translate-a64.c | 106 -----------------------------
+file changed, 1 insertion(+), 5 deletions(-)
  target/arm/translate.c     | 134 ++++++++++++++++++++++++++++++++-----
 files changed, 120 insertions(+), 122 deletions(-)
-diff --git a/target/arm/translate.h b/target/arm/translate.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.h
-+++ b/target/arm/translate.h
-@@ -XXX,XX +XXX,XX @@ static inline TCGv_i32 get_ahp_flag(void)
- extern const GVecGen3 bsl_op;
- extern const GVecGen3 bit_op;
- extern const GVecGen3 bif_op;
-+extern const GVecGen3 mla_op[4];
-+extern const GVecGen3 mls_op[4];
- extern const GVecGen2i ssra_op[4];
- extern const GVecGen2i usra_op[4];
- extern const GVecGen2i sri_op[4];
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_3same_float(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static void shift_reg_imm(TCGv_i64 dst, TCGv_i64 src, int sf,
      if (shift_i == 0) {
          tcg_gen_mov_i64(dst, src);
      } else {
 -        TCGv_i64 shift_const;
 -
 -        shift_const = tcg_const_i64(shift_i);
 -        shift_reg(dst, src, sf, shift_type, shift_const);
 -        tcg_temp_free_i64(shift_const);
 +        shift_reg(dst, src, sf, shift_type, tcg_constant_i64(shift_i));
      }
  }
--static void gen_mla8_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
--{
--    gen_helper_neon_mul_u8(a, a, b);
--    gen_helper_neon_add_u8(d, d, a);
--}
--
--static void gen_mla16_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
--{
--    gen_helper_neon_mul_u16(a, a, b);
--    gen_helper_neon_add_u16(d, d, a);
--}
--
--static void gen_mla32_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
--{
--    tcg_gen_mul_i32(a, a, b);
--    tcg_gen_add_i32(d, d, a);
--}
--
--static void gen_mla64_i64(TCGv_i64 d, TCGv_i64 a, TCGv_i64 b)
--{
--    tcg_gen_mul_i64(a, a, b);
--    tcg_gen_add_i64(d, d, a);
--}
--
--static void gen_mla_vec(unsigned vece, TCGv_vec d, TCGv_vec a, TCGv_vec b)
--{
--    tcg_gen_mul_vec(vece, a, a, b);
--    tcg_gen_add_vec(vece, d, d, a);
--}
--
--static void gen_mls8_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
--{
--    gen_helper_neon_mul_u8(a, a, b);
--    gen_helper_neon_sub_u8(d, d, a);
--}
--
--static void gen_mls16_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
--{
--    gen_helper_neon_mul_u16(a, a, b);
--    gen_helper_neon_sub_u16(d, d, a);
--}
--
--static void gen_mls32_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
--{
--    tcg_gen_mul_i32(a, a, b);
--    tcg_gen_sub_i32(d, d, a);
--}
--
--static void gen_mls64_i64(TCGv_i64 d, TCGv_i64 a, TCGv_i64 b)
--{
--    tcg_gen_mul_i64(a, a, b);
--    tcg_gen_sub_i64(d, d, a);
--}
--
--static void gen_mls_vec(unsigned vece, TCGv_vec d, TCGv_vec a, TCGv_vec b)
--{
--    tcg_gen_mul_vec(vece, a, a, b);
--    tcg_gen_sub_vec(vece, d, d, a);
--}
--
- /* Integer op subgroup of C3.6.16. */
- static void disas_simd_3same_int(DisasContext *s, uint32_t insn)
- {
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_3same_int(DisasContext *s, uint32_t insn)
-           .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-           .vece = MO_64 },
-     };
--    static const GVecGen3 mla_op[4] = {
--        { .fni4 = gen_mla8_i32,
--          .fniv = gen_mla_vec,
--          .opc = INDEX_op_mul_vec,
--          .load_dest = true,
--          .vece = MO_8 },
--        { .fni4 = gen_mla16_i32,
--          .fniv = gen_mla_vec,
--          .opc = INDEX_op_mul_vec,
--          .load_dest = true,
--          .vece = MO_16 },
--        { .fni4 = gen_mla32_i32,
--          .fniv = gen_mla_vec,
--          .opc = INDEX_op_mul_vec,
--          .load_dest = true,
--          .vece = MO_32 },
--        { .fni8 = gen_mla64_i64,
--          .fniv = gen_mla_vec,
--          .opc = INDEX_op_mul_vec,
--          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
--          .load_dest = true,
--          .vece = MO_64 },
--    };
--    static const GVecGen3 mls_op[4] = {
--        { .fni4 = gen_mls8_i32,
--          .fniv = gen_mls_vec,
--          .opc = INDEX_op_mul_vec,
--          .load_dest = true,
--          .vece = MO_8 },
--        { .fni4 = gen_mls16_i32,
--          .fniv = gen_mls_vec,
--          .opc = INDEX_op_mul_vec,
--          .load_dest = true,
--          .vece = MO_16 },
--        { .fni4 = gen_mls32_i32,
--          .fniv = gen_mls_vec,
--          .opc = INDEX_op_mul_vec,
--          .load_dest = true,
--          .vece = MO_32 },
--        { .fni8 = gen_mls64_i64,
--          .fniv = gen_mls_vec,
--          .opc = INDEX_op_mul_vec,
--          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
--          .load_dest = true,
--          .vece = MO_64 },
--    };
-     int is_q = extract32(insn, 30, 1);
-     int u = extract32(insn, 29, 1);
-diff --git a/target/arm/translate.c b/target/arm/translate.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
-+++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static void gen_neon_narrow_op(int op, int u, int size,
- #define NEON_3R_VABA 15
- #define NEON_3R_VADD_VSUB 16
- #define NEON_3R_VTST_VCEQ 17
--#define NEON_3R_VML 18 /* VMLA, VMLAL, VMLS, VMLSL */
-+#define NEON_3R_VML 18 /* VMLA, VMLS */
- #define NEON_3R_VMUL 19
- #define NEON_3R_VPMAX 20
- #define NEON_3R_VPMIN 21
-@@ -XXX,XX +XXX,XX @@ const GVecGen2i sli_op[4] = {
-       .vece = MO_64 },
- };
-+static void gen_mla8_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
-+{
-+    gen_helper_neon_mul_u8(a, a, b);
-+    gen_helper_neon_add_u8(d, d, a);
-+}
-+
-+static void gen_mls8_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
-+{
-+    gen_helper_neon_mul_u8(a, a, b);
-+    gen_helper_neon_sub_u8(d, d, a);
-+}
-+
-+static void gen_mla16_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
-+{
-+    gen_helper_neon_mul_u16(a, a, b);
-+    gen_helper_neon_add_u16(d, d, a);
-+}
-+
-+static void gen_mls16_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
-+{
-+    gen_helper_neon_mul_u16(a, a, b);
-+    gen_helper_neon_sub_u16(d, d, a);
-+}
-+
-+static void gen_mla32_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
-+{
-+    tcg_gen_mul_i32(a, a, b);
-+    tcg_gen_add_i32(d, d, a);
-+}
-+
-+static void gen_mls32_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
-+{
-+    tcg_gen_mul_i32(a, a, b);
-+    tcg_gen_sub_i32(d, d, a);
-+}
-+
-+static void gen_mla64_i64(TCGv_i64 d, TCGv_i64 a, TCGv_i64 b)
-+{
-+    tcg_gen_mul_i64(a, a, b);
-+    tcg_gen_add_i64(d, d, a);
-+}
-+
-+static void gen_mls64_i64(TCGv_i64 d, TCGv_i64 a, TCGv_i64 b)
-+{
-+    tcg_gen_mul_i64(a, a, b);
-+    tcg_gen_sub_i64(d, d, a);
-+}
-+
-+static void gen_mla_vec(unsigned vece, TCGv_vec d, TCGv_vec a, TCGv_vec b)
-+{
-+    tcg_gen_mul_vec(vece, a, a, b);
-+    tcg_gen_add_vec(vece, d, d, a);
-+}
-+
-+static void gen_mls_vec(unsigned vece, TCGv_vec d, TCGv_vec a, TCGv_vec b)
-+{
-+    tcg_gen_mul_vec(vece, a, a, b);
-+    tcg_gen_sub_vec(vece, d, d, a);
-+}
-+
-+/* Note that while NEON does not support VMLA and VMLS as 64-bit ops,
-+ * these tables are shared with AArch64 which does support them.
-+ */
-+const GVecGen3 mla_op[4] = {
-+    { .fni4 = gen_mla8_i32,
-+      .fniv = gen_mla_vec,
-+      .opc = INDEX_op_mul_vec,
-+      .load_dest = true,
-+      .vece = MO_8 },
-+    { .fni4 = gen_mla16_i32,
-+      .fniv = gen_mla_vec,
-+      .opc = INDEX_op_mul_vec,
-+      .load_dest = true,
-+      .vece = MO_16 },
-+    { .fni4 = gen_mla32_i32,
-+      .fniv = gen_mla_vec,
-+      .opc = INDEX_op_mul_vec,
-+      .load_dest = true,
-+      .vece = MO_32 },
-+    { .fni8 = gen_mla64_i64,
-+      .fniv = gen_mla_vec,
-+      .opc = INDEX_op_mul_vec,
-+      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-+      .load_dest = true,
-+      .vece = MO_64 },
-+};
-+
-+const GVecGen3 mls_op[4] = {
-+    { .fni4 = gen_mls8_i32,
-+      .fniv = gen_mls_vec,
-+      .opc = INDEX_op_mul_vec,
-+      .load_dest = true,
-+      .vece = MO_8 },
-+    { .fni4 = gen_mls16_i32,
-+      .fniv = gen_mls_vec,
-+      .opc = INDEX_op_mul_vec,
-+      .load_dest = true,
-+      .vece = MO_16 },
-+    { .fni4 = gen_mls32_i32,
-+      .fniv = gen_mls_vec,
-+      .opc = INDEX_op_mul_vec,
-+      .load_dest = true,
-+      .vece = MO_32 },
-+    { .fni8 = gen_mls64_i64,
-+      .fniv = gen_mls_vec,
-+      .opc = INDEX_op_mul_vec,
-+      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-+      .load_dest = true,
-+      .vece = MO_64 },
-+};
-+
- /* Translate a NEON data processing instruction.  Return nonzero if the
-    instruction is invalid.
-    We process data in a mixture of 32-bit and 64-bit chunks.
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                 return 0;
-             }
-             break;
-+
-+        case NEON_3R_VML: /* VMLA, VMLS */
-+            tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs, vec_size, vec_size,
-+                           u ? &mls_op[size] : &mla_op[size]);
-+            return 0;
-         }
-+
-         if (size == 3) {
-             /* 64-bit element instructions. */
-             for (pass = 0; pass < (q ? 2 : 1); pass++) {
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                 }
-             }
-             break;
--        case NEON_3R_VML: /* VMLA, VMLAL, VMLS,VMLSL */
--            switch (size) {
--            case 0: gen_helper_neon_mul_u8(tmp, tmp, tmp2); break;
--            case 1: gen_helper_neon_mul_u16(tmp, tmp, tmp2); break;
--            case 2: tcg_gen_mul_i32(tmp, tmp, tmp2); break;
--            default: abort();
--            }
--            tcg_temp_free_i32(tmp2);
--            tmp2 = neon_load_reg(rd, pass);
--            if (u) { /* VMLS */
--                gen_neon_rsb(size, tmp, tmp2);
--            } else { /* VMLA */
--                gen_neon_add(size, tmp, tmp2);
--            }
--            break;
-         case NEON_3R_VMUL:
-             /* VMUL.P8; other cases already eliminated.  */
-             gen_helper_neon_mul_p8(tmp, tmp, tmp2);
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 10/45] target/arm: Convert v8.2-fp16 from feature bit to aa64pfr0 test
+[PULL 14/54] target/arm: Use tcg_constant in disas_cond_select
 From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181016223115.24100-9-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-15-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.h           | 17 +++++++++++++++-
+ target/arm/translate-a64.c | 3 +--
- linux-user/elfload.c       |  6 +-----
+file changed, 1 insertion(+), 2 deletions(-)
  target/arm/cpu64.c         | 16 ++++++++-------
  target/arm/helper.c        |  2 +-
  target/arm/translate-a64.c | 40 +++++++++++++++++++-------------------
  target/arm/translate.c     |  6 +++---
 files changed, 50 insertions(+), 37 deletions(-)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
-+++ b/target/arm/cpu.h
-@@ -XXX,XX +XXX,XX @@ enum arm_features {
-     ARM_FEATURE_PMU, /* has PMU support */
-     ARM_FEATURE_VBAR, /* has cp15 VBAR */
-     ARM_FEATURE_M_SECURITY, /* M profile Security Extension */
--    ARM_FEATURE_V8_FP16, /* implements v8.2 half-precision float */
-     ARM_FEATURE_M_MAIN, /* M profile Main Extension */
- };
-@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_aa32_dp(const ARMISARegisters *id)
-     return FIELD_EX32(id->id_isar6, ID_ISAR6, DP) != 0;
- }
-+static inline bool isar_feature_aa32_fp16_arith(const ARMISARegisters *id)
-+{
-+    /*
-+     * This is a placeholder for use by VCMA until the rest of
-+     * the ARMv8.2-FP16 extension is implemented for aa32 mode.
-+     * At which point we can properly set and check MVFR1.FPHP.
-+     */
-+    return FIELD_EX64(id->id_aa64pfr0, ID_AA64PFR0, FP) == 1;
-+}
-+
- /*
-  * 64-bit feature tests via id registers.
-  */
-@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_aa64_fcma(const ARMISARegisters *id)
-     return FIELD_EX64(id->id_aa64isar1, ID_AA64ISAR1, FCMA) != 0;
- }
-+static inline bool isar_feature_aa64_fp16(const ARMISARegisters *id)
-+{
-+    /* We always set the AdvSIMD and FP fields identically wrt FP16.  */
-+    return FIELD_EX64(id->id_aa64pfr0, ID_AA64PFR0, FP) == 1;
-+}
-+
- static inline bool isar_feature_aa64_sve(const ARMISARegisters *id)
- {
-     return FIELD_EX64(id->id_aa64pfr0, ID_AA64PFR0, SVE) != 0;
-diff --git a/linux-user/elfload.c b/linux-user/elfload.c
-index XXXXXXX..XXXXXXX 100644
---- a/linux-user/elfload.c
-+++ b/linux-user/elfload.c
-@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
-     hwcaps |= ARM_HWCAP_A64_ASIMD;
-     /* probe for the extra features */
--#define GET_FEATURE(feat, hwcap) \
--    do { if (arm_feature(&cpu->env, feat)) { hwcaps |= hwcap; } } while (0)
- #define GET_FEATURE_ID(feat, hwcap) \
-     do { if (cpu_isar_feature(feat, cpu)) { hwcaps |= hwcap; } } while (0)
-@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
-     GET_FEATURE_ID(aa64_sha3, ARM_HWCAP_A64_SHA3);
-     GET_FEATURE_ID(aa64_sm3, ARM_HWCAP_A64_SM3);
-     GET_FEATURE_ID(aa64_sm4, ARM_HWCAP_A64_SM4);
--    GET_FEATURE(ARM_FEATURE_V8_FP16,
--                ARM_HWCAP_A64_FPHP | ARM_HWCAP_A64_ASIMDHP);
-+    GET_FEATURE_ID(aa64_fp16, ARM_HWCAP_A64_FPHP | ARM_HWCAP_A64_ASIMDHP);
-     GET_FEATURE_ID(aa64_atomics, ARM_HWCAP_A64_ATOMICS);
-     GET_FEATURE_ID(aa64_rdm, ARM_HWCAP_A64_ASIMDRDM);
-     GET_FEATURE_ID(aa64_dp, ARM_HWCAP_A64_ASIMDDP);
-     GET_FEATURE_ID(aa64_fcma, ARM_HWCAP_A64_FCMA);
-     GET_FEATURE_ID(aa64_sve, ARM_HWCAP_A64_SVE);
--#undef GET_FEATURE
- #undef GET_FEATURE_ID
-     return hwcaps;
-diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu64.c
-+++ b/target/arm/cpu64.c
-@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
-         t = cpu->isar.id_aa64pfr0;
-         t = FIELD_DP64(t, ID_AA64PFR0, SVE, 1);
-+        t = FIELD_DP64(t, ID_AA64PFR0, FP, 1);
-+        t = FIELD_DP64(t, ID_AA64PFR0, ADVSIMD, 1);
-         cpu->isar.id_aa64pfr0 = t;
-         /* Replicate the same data to the 32-bit id registers.  */
-@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
-         u = FIELD_DP32(u, ID_ISAR6, DP, 1);
-         cpu->isar.id_isar6 = u;
--#ifdef CONFIG_USER_ONLY
--        /* We don't set these in system emulation mode for the moment,
--         * since we don't correctly set the ID registers to advertise them,
--         * and in some cases they're only available in AArch64 and not AArch32,
--         * whereas the architecture requires them to be present in both if
--         * present in either.
-+        /*
-+         * FIXME: We do not yet support ARMv8.2-fp16 for AArch32 yet,
-+         * so do not set MVFR1.FPHP.  Strictly speaking this is not legal,
-+         * but it is also not legal to enable SVE without support for FP16,
-+         * and enabling SVE in system mode is more useful in the short term.
-          */
--        set_feature(&cpu->env, ARM_FEATURE_V8_FP16);
-+
-+#ifdef CONFIG_USER_ONLY
-         /* For usermode -cpu max we can use a larger and more efficient DCZ
-          * blocksize since we don't have to follow what the hardware does.
-          */
-diff --git a/target/arm/helper.c b/target/arm/helper.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
-+++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ void HELPER(vfp_set_fpscr)(CPUARMState *env, uint32_t val)
-     uint32_t changed;
-     /* When ARMv8.2-FP16 is not supported, FZ16 is RES0.  */
--    if (!arm_feature(env, ARM_FEATURE_V8_FP16)) {
-+    if (!cpu_isar_feature(aa64_fp16, arm_env_get_cpu(env))) {
-         val &= ~FPCR_FZ16;
-     }
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
-@@ -XXX,XX +XXX,XX @@ static void disas_fp_compare(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static void disas_cond_select(DisasContext *s, uint32_t insn)
-         break;
+     tcg_rd = cpu_reg(s, rd);
-     case 3:
-         size = MO_16;
+     a64_test_cc(&c, cond);
--        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+-    zero = tcg_const_i64(0);
-+        if (dc_isar_feature(aa64_fp16, s)) {
++    zero = tcg_constant_i64(0);
-             break;
-         }
+     if (rn == 31 && rm == 31 && (else_inc ^ else_inv)) {
-         /* fallthru */
+         /* CSET & CSETM.  */
-@@ -XXX,XX +XXX,XX @@ static void disas_fp_ccomp(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static void disas_cond_select(DisasContext *s, uint32_t insn)
-         break;
+         tcg_gen_movcond_i64(c.cond, tcg_rd, c.value, zero, t_true, t_false);
      case 3:
          size = MO_16;
 -        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (dc_isar_feature(aa64_fp16, s)) {
              break;
          }
          /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_csel(DisasContext *s, uint32_t insn)
          break;
      case 3:
          sz = MO_16;
 -        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (dc_isar_feature(aa64_fp16, s)) {
              break;
          }
          /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_1src(DisasContext *s, uint32_t insn)
              handle_fp_1src_double(s, opcode, rd, rn);
              break;
          case 3:
 -            if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +            if (!dc_isar_feature(aa64_fp16, s)) {
                  unallocated_encoding(s);
                  return;
              }
@@ -XXX,XX +XXX,XX @@ static void disas_fp_2src(DisasContext *s, uint32_t insn)
          handle_fp_2src_double(s, opcode, rd, rn, rm);
          break;
      case 3:
 -        if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (!dc_isar_feature(aa64_fp16, s)) {
              unallocated_encoding(s);
              return;
          }
@@ -XXX,XX +XXX,XX @@ static void disas_fp_3src(DisasContext *s, uint32_t insn)
          handle_fp_3src_double(s, o0, o1, rd, rn, rm, ra);
          break;
      case 3:
 -        if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (!dc_isar_feature(aa64_fp16, s)) {
              unallocated_encoding(s);
              return;
          }
@@ -XXX,XX +XXX,XX @@ static void disas_fp_imm(DisasContext *s, uint32_t insn)
          break;
      case 3:
          sz = MO_16;
 -        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (dc_isar_feature(aa64_fp16, s)) {
              break;
          }
          /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_fixed_conv(DisasContext *s, uint32_t insn)
      case 1: /* float64 */
          break;
      case 3: /* float16 */
 -        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (dc_isar_feature(aa64_fp16, s)) {
              break;
          }
          /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_int_conv(DisasContext *s, uint32_t insn)
              break;
          case 0x6: /* 16-bit float, 32-bit int */
          case 0xe: /* 16-bit float, 64-bit int */
 -            if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +            if (dc_isar_feature(aa64_fp16, s)) {
                  break;
              }
              /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_int_conv(DisasContext *s, uint32_t insn)
          case 1: /* float64 */
              break;
          case 3: /* float16 */
 -            if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +            if (dc_isar_feature(aa64_fp16, s)) {
                  break;
              }
              /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_across_lanes(DisasContext *s, uint32_t insn)
           */
          is_min = extract32(size, 1, 1);
          is_fp = true;
 -        if (!is_u && arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (!is_u && dc_isar_feature(aa64_fp16, s)) {
              size = 1;
          } else if (!is_u || !is_q || extract32(size, 0, 1)) {
              unallocated_encoding(s);
@@ -XXX,XX +XXX,XX @@ static void disas_simd_mod_imm(DisasContext *s, uint32_t insn)
      if (o2 != 0 || ((cmode == 0xf) && is_neg && !is_q)) {
          /* Check for FMOV (vector, immediate) - half-precision */
 -        if (!(arm_dc_feature(s, ARM_FEATURE_V8_FP16) && o2 && cmode == 0xf)) {
 +        if (!(dc_isar_feature(aa64_fp16, s) && o2 && cmode == 0xf)) {
              unallocated_encoding(s);
              return;
          }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_pairwise(DisasContext *s, uint32_t insn)
      case 0x2f: /* FMINP */
          /* FP op, size[0] is 32 or 64 bit*/
          if (!u) {
 -            if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +            if (!dc_isar_feature(aa64_fp16, s)) {
                  unallocated_encoding(s);
                  return;
              } else {
@@ -XXX,XX +XXX,XX @@ static void handle_simd_shift_intfp_conv(DisasContext *s, bool is_scalar,
          size = MO_32;
      } else if (immh & 2) {
          size = MO_16;
 -        if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (!dc_isar_feature(aa64_fp16, s)) {
              unallocated_encoding(s);
              return;
          }
@@ -XXX,XX +XXX,XX @@ static void handle_simd_shift_fpint_conv(DisasContext *s, bool is_scalar,
          size = MO_32;
      } else if (immh & 0x2) {
          size = MO_16;
 -        if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (!dc_isar_feature(aa64_fp16, s)) {
              unallocated_encoding(s);
              return;
          }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_three_reg_same_fp16(DisasContext *s,
          return;
      }
--    if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+-    tcg_temp_free_i64(zero);
-+    if (!dc_isar_feature(aa64_fp16, s)) {
+     a64_free_cc(&c);
-         unallocated_encoding(s);
-     }
+     if (!sf) {
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_fp16(DisasContext *s, uint32_t insn)
      TCGv_ptr fpst;
      bool pairwise = false;
 -    if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +    if (!dc_isar_feature(aa64_fp16, s)) {
          unallocated_encoding(s);
          return;
      }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
      case 0x1c: /* FCADD, #90 */
      case 0x1e: /* FCADD, #270 */
          if (size == 0
 -            || (size == 1 && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))
 +            || (size == 1 && !dc_isar_feature(aa64_fp16, s))
              || (size == 3 && !is_q)) {
              unallocated_encoding(s);
              return;
@@ -XXX,XX +XXX,XX @@ static void disas_simd_two_reg_misc_fp16(DisasContext *s, uint32_t insn)
      bool need_fpst = true;
      int rmode;
 -    if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +    if (!dc_isar_feature(aa64_fp16, s)) {
          unallocated_encoding(s);
          return;
      }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
          }
          break;
      }
 -    if (is_fp16 && !arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +    if (is_fp16 && !dc_isar_feature(aa64_fp16, s)) {
          unallocated_encoding(s);
          return;
      }
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
          int size = extract32(insn, 20, 1);
          data = extract32(insn, 23, 2); /* rot */
          if (!dc_isar_feature(aa32_vcma, s)
 -            || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
 +            || (!size && !dc_isar_feature(aa32_fp16_arith, s))) {
              return 1;
          }
          fn_gvec_ptr = size ? gen_helper_gvec_fcmlas : gen_helper_gvec_fcmlah;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
          int size = extract32(insn, 20, 1);
          data = extract32(insn, 24, 1); /* rot */
          if (!dc_isar_feature(aa32_vcma, s)
 -            || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
 +            || (!size && !dc_isar_feature(aa32_fp16_arith, s))) {
              return 1;
          }
          fn_gvec_ptr = size ? gen_helper_gvec_fcadds : gen_helper_gvec_fcaddh;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
              return 1;
          }
          if (size == 0) {
 -            if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +            if (!dc_isar_feature(aa32_fp16_arith, s)) {
                  return 1;
              }
              /* For fp16, rm is just Vm, and index is M.  */
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 25/45] target/arm: Promote consecutive memory ops for aa64
+[PULL 15/54] target/arm: Use tcg_constant in handle_{rev16,crc32}
 From: Richard Henderson <richard.henderson@linaro.org>
-For a sequence of loads or stores from a single register,
-little-endian operations can be promoted to an 8-byte op.
-This can reduce the number of operations by a factor of 8.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-5-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-16-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate-a64.c | 66 +++++++++++++++++++++++---------------
+ target/arm/translate-a64.c | 7 ++-----
-file changed, 40 insertions(+), 26 deletions(-)
+file changed, 2 insertions(+), 5 deletions(-)
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
-@@ -XXX,XX +XXX,XX @@ static void write_vec_element_i32(DisasContext *s, TCGv_i32 tcg_src,
+@@ -XXX,XX +XXX,XX @@ static void handle_rev16(DisasContext *s, unsigned int sf,
+     TCGv_i64 tcg_rd = cpu_reg(s, rd);
  /* Store from vector register to memory */
  static void do_vec_st(DisasContext *s, int srcidx, int element,
 -                      TCGv_i64 tcg_addr, int size)
 +                      TCGv_i64 tcg_addr, int size, TCGMemOp endian)
  {
 -    TCGMemOp memop = s->be_data + size;
      TCGv_i64 tcg_tmp = tcg_temp_new_i64();
+     TCGv_i64 tcg_rn = read_cpu_reg(s, rn, sf);
-     read_vec_element(s, tcg_tmp, srcidx, element, size);
+-    TCGv_i64 mask = tcg_const_i64(sf ? 0x00ff00ff00ff00ffull : 0x00ff00ff);
--    tcg_gen_qemu_st_i64(tcg_tmp, tcg_addr, get_mem_index(s), memop);
++    TCGv_i64 mask = tcg_constant_i64(sf ? 0x00ff00ff00ff00ffull : 0x00ff00ff);
-+    tcg_gen_qemu_st_i64(tcg_tmp, tcg_addr, get_mem_index(s), endian | size);
+     tcg_gen_shri_i64(tcg_tmp, tcg_rn, 8);
      tcg_gen_and_i64(tcg_rd, tcg_rn, mask);
@@ -XXX,XX +XXX,XX @@ static void handle_rev16(DisasContext *s, unsigned int sf,
      tcg_gen_shli_i64(tcg_rd, tcg_rd, 8);
      tcg_gen_or_i64(tcg_rd, tcg_rd, tcg_tmp);
 -    tcg_temp_free_i64(mask);
      tcg_temp_free_i64(tcg_tmp);
  }
- /* Load from memory to vector register */
+@@ -XXX,XX +XXX,XX @@ static void handle_crc32(DisasContext *s,
  static void do_vec_ld(DisasContext *s, int destidx, int element,
 -                      TCGv_i64 tcg_addr, int size)
 +                      TCGv_i64 tcg_addr, int size, TCGMemOp endian)
  {
 -    TCGMemOp memop = s->be_data + size;
      TCGv_i64 tcg_tmp = tcg_temp_new_i64();
 -    tcg_gen_qemu_ld_i64(tcg_tmp, tcg_addr, get_mem_index(s), memop);
 +    tcg_gen_qemu_ld_i64(tcg_tmp, tcg_addr, get_mem_index(s), endian | size);
      write_vec_element(s, tcg_tmp, destidx, element, size);
      tcg_temp_free_i64(tcg_tmp);
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
      bool is_postidx = extract32(insn, 23, 1);
      bool is_q = extract32(insn, 30, 1);
      TCGv_i64 tcg_addr, tcg_rn, tcg_ebytes;
 +    TCGMemOp endian = s->be_data;
 -    int ebytes = 1 << size;
 -    int elements = (is_q ? 128 : 64) / (8 << size);
 +    int ebytes;   /* bytes per element */
 +    int elements; /* elements per vector */
      int rpt;    /* num iterations */
      int selem;  /* structure elements */
      int r;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
          gen_check_sp_alignment(s);
      }
-+    /* For our purposes, bytes are always little-endian.  */
+     tcg_acc = cpu_reg(s, rn);
-+    if (size == 0) {
+-    tcg_bytes = tcg_const_i32(1 << sz);
-+        endian = MO_LE;
++    tcg_bytes = tcg_constant_i32(1 << sz);
-+    }
-+
+     if (crc32c) {
-+    /* Consecutive little-endian elements from a single register
+         gen_helper_crc32c_64(cpu_reg(s, rd), tcg_acc, tcg_val, tcg_bytes);
-+     * can be promoted to a larger little-endian operation.
+     } else {
-+     */
+         gen_helper_crc32_64(cpu_reg(s, rd), tcg_acc, tcg_val, tcg_bytes);
-+    if (selem == 1 && endian == MO_LE) {
+     }
 +        size = 3;
 +    }
 +    ebytes = 1 << size;
 +    elements = (is_q ? 16 : 8) / ebytes;
 +
      tcg_rn = cpu_reg_sp(s, rn);
      tcg_addr = tcg_temp_new_i64();
      tcg_gen_mov_i64(tcg_addr, tcg_rn);
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
      for (r = 0; r < rpt; r++) {
          int e;
          for (e = 0; e < elements; e++) {
 -            int tt = (rt + r) % 32;
              int xs;
              for (xs = 0; xs < selem; xs++) {
 +                int tt = (rt + r + xs) % 32;
                  if (is_store) {
 -                    do_vec_st(s, tt, e, tcg_addr, size);
 +                    do_vec_st(s, tt, e, tcg_addr, size, endian);
                  } else {
 -                    do_vec_ld(s, tt, e, tcg_addr, size);
 -
--                    /* For non-quad operations, setting a slice of the low
+-    tcg_temp_free_i32(tcg_bytes);
--                     * 64 bits of the register clears the high 64 bits (in
+ }
--                     * the ARM ARM pseudocode this is implicit in the fact
--                     * that 'rval' is a 64 bit wide variable).
+ /* Data-processing (2 source)
 -                     * For quad operations, we might still need to zero the
 -                     * high bits of SVE.  We optimize by noticing that we only
 -                     * need to do this the first time we touch a register.
 -                     */
 -                    if (e == 0 && (r == 0 || xs == selem - 1)) {
 -                        clear_vec_high(s, is_q, tt);
 -                    }
 +                    do_vec_ld(s, tt, e, tcg_addr, size, endian);
                  }
                  tcg_gen_add_i64(tcg_addr, tcg_addr, tcg_ebytes);
 -                tt = (tt + 1) % 32;
              }
          }
      }
 +    if (!is_store) {
 +        /* For non-quad operations, setting a slice of the low
 +         * 64 bits of the register clears the high 64 bits (in
 +         * the ARM ARM pseudocode this is implicit in the fact
 +         * that 'rval' is a 64 bit wide variable).
 +         * For quad operations, we might still need to zero the
 +         * high bits of SVE.
 +         */
 +        for (r = 0; r < rpt * selem; r++) {
 +            int tt = (rt + r) % 32;
 +            clear_vec_high(s, is_q, tt);
 +        }
 +    }
 +
      if (is_postidx) {
          int rm = extract32(insn, 16, 5);
          if (rm == 31) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
          } else {
              /* Load/store one element per register */
              if (is_load) {
 -                do_vec_ld(s, rt, index, tcg_addr, scale);
 +                do_vec_ld(s, rt, index, tcg_addr, scale, s->be_data);
              } else {
 -                do_vec_st(s, rt, index, tcg_addr, scale);
 +                do_vec_st(s, rt, index, tcg_addr, scale, s->be_data);
              }
          }
          tcg_gen_add_i64(tcg_addr, tcg_addr, tcg_ebytes);
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 34/45] target/arm: Use gvec for VSRA
+[PULL 16/54] target/arm: Use tcg_constant in disas_data_proc_2src
 From: Richard Henderson <richard.henderson@linaro.org>
-Move ssra_op and usra_op expanders from translate-a64.c.
+Existing temp usage treats t1 as both zero and as a
 temporary.  Rearrange to only require one temporary,
 so remove t1 and rename t2.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-14-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-17-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.h     |   2 +
+ target/arm/translate-a64.c | 12 +++++-------
- target/arm/translate-a64.c | 106 ----------------------------
+file changed, 5 insertions(+), 7 deletions(-)
  target/arm/translate.c     | 139 ++++++++++++++++++++++++++++++++++---
 files changed, 130 insertions(+), 117 deletions(-)
-diff --git a/target/arm/translate.h b/target/arm/translate.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.h
-+++ b/target/arm/translate.h
-@@ -XXX,XX +XXX,XX @@ static inline TCGv_i32 get_ahp_flag(void)
- extern const GVecGen3 bsl_op;
- extern const GVecGen3 bit_op;
- extern const GVecGen3 bif_op;
-+extern const GVecGen2i ssra_op[4];
-+extern const GVecGen2i usra_op[4];
- /*
-  * Forward to the isar_feature_* tests given a DisasContext pointer.
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_two_reg_misc(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static void disas_data_proc_2src(DisasContext *s, uint32_t insn)
-     }
+         if (sf == 0 || !dc_isar_feature(aa64_mte_insn_reg, s)) {
- }
+             goto do_unallocated;
+         } else {
--static void gen_ssra8_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+-            TCGv_i64 t1 = tcg_const_i64(1);
--{
+-            TCGv_i64 t2 = tcg_temp_new_i64();
--    tcg_gen_vec_sar8i_i64(a, a, shift);
++            TCGv_i64 t = tcg_temp_new_i64();
--    tcg_gen_vec_add8_i64(d, d, a);
--}
+-            tcg_gen_extract_i64(t2, cpu_reg_sp(s, rn), 56, 4);
--
+-            tcg_gen_shl_i64(t1, t1, t2);
--static void gen_ssra16_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+-            tcg_gen_or_i64(cpu_reg(s, rd), cpu_reg(s, rm), t1);
--{
++            tcg_gen_extract_i64(t, cpu_reg_sp(s, rn), 56, 4);
--    tcg_gen_vec_sar16i_i64(a, a, shift);
++            tcg_gen_shl_i64(t, tcg_constant_i64(1), t);
--    tcg_gen_vec_add16_i64(d, d, a);
++            tcg_gen_or_i64(cpu_reg(s, rd), cpu_reg(s, rm), t);
--}
--
+-            tcg_temp_free_i64(t1);
--static void gen_ssra32_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
+-            tcg_temp_free_i64(t2);
--{
++            tcg_temp_free_i64(t);
--    tcg_gen_sari_i32(a, a, shift);
+         }
--    tcg_gen_add_i32(d, d, a);
+         break;
--}
+     case 8: /* LSLV */
 -
 -static void gen_ssra64_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 -{
 -    tcg_gen_sari_i64(a, a, shift);
 -    tcg_gen_add_i64(d, d, a);
 -}
 -
 -static void gen_ssra_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
 -{
 -    tcg_gen_sari_vec(vece, a, a, sh);
 -    tcg_gen_add_vec(vece, d, d, a);
 -}
 -
 -static void gen_usra8_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 -{
 -    tcg_gen_vec_shr8i_i64(a, a, shift);
 -    tcg_gen_vec_add8_i64(d, d, a);
 -}
 -
 -static void gen_usra16_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 -{
 -    tcg_gen_vec_shr16i_i64(a, a, shift);
 -    tcg_gen_vec_add16_i64(d, d, a);
 -}
 -
 -static void gen_usra32_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
 -{
 -    tcg_gen_shri_i32(a, a, shift);
 -    tcg_gen_add_i32(d, d, a);
 -}
 -
 -static void gen_usra64_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 -{
 -    tcg_gen_shri_i64(a, a, shift);
 -    tcg_gen_add_i64(d, d, a);
 -}
 -
 -static void gen_usra_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
 -{
 -    tcg_gen_shri_vec(vece, a, a, sh);
 -    tcg_gen_add_vec(vece, d, d, a);
 -}
 -
  static void gen_shr8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
  {
      uint64_t mask = dup_const(MO_8, 0xff >> shift);
@@ -XXX,XX +XXX,XX @@ static void gen_shr_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
  static void handle_vec_simd_shri(DisasContext *s, bool is_q, bool is_u,
                                   int immh, int immb, int opcode, int rn, int rd)
  {
 -    static const GVecGen2i ssra_op[4] = {
 -        { .fni8 = gen_ssra8_i64,
 -          .fniv = gen_ssra_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_sari_vec,
 -          .vece = MO_8 },
 -        { .fni8 = gen_ssra16_i64,
 -          .fniv = gen_ssra_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_sari_vec,
 -          .vece = MO_16 },
 -        { .fni4 = gen_ssra32_i32,
 -          .fniv = gen_ssra_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_sari_vec,
 -          .vece = MO_32 },
 -        { .fni8 = gen_ssra64_i64,
 -          .fniv = gen_ssra_vec,
 -          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -          .load_dest = true,
 -          .opc = INDEX_op_sari_vec,
 -          .vece = MO_64 },
 -    };
 -    static const GVecGen2i usra_op[4] = {
 -        { .fni8 = gen_usra8_i64,
 -          .fniv = gen_usra_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_shri_vec,
 -          .vece = MO_8, },
 -        { .fni8 = gen_usra16_i64,
 -          .fniv = gen_usra_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_shri_vec,
 -          .vece = MO_16, },
 -        { .fni4 = gen_usra32_i32,
 -          .fniv = gen_usra_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_shri_vec,
 -          .vece = MO_32, },
 -        { .fni8 = gen_usra64_i64,
 -          .fniv = gen_usra_vec,
 -          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -          .load_dest = true,
 -          .opc = INDEX_op_shri_vec,
 -          .vece = MO_64, },
 -    };
      static const GVecGen2i sri_op[4] = {
          { .fni8 = gen_shr8_ins_i64,
            .fniv = gen_shr_ins_vec,
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ const GVecGen3 bif_op = {
      .load_dest = true
  };
 +static void gen_ssra8_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    tcg_gen_vec_sar8i_i64(a, a, shift);
 +    tcg_gen_vec_add8_i64(d, d, a);
 +}
 +
 +static void gen_ssra16_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    tcg_gen_vec_sar16i_i64(a, a, shift);
 +    tcg_gen_vec_add16_i64(d, d, a);
 +}
 +
 +static void gen_ssra32_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
 +{
 +    tcg_gen_sari_i32(a, a, shift);
 +    tcg_gen_add_i32(d, d, a);
 +}
 +
 +static void gen_ssra64_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    tcg_gen_sari_i64(a, a, shift);
 +    tcg_gen_add_i64(d, d, a);
 +}
 +
 +static void gen_ssra_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
 +{
 +    tcg_gen_sari_vec(vece, a, a, sh);
 +    tcg_gen_add_vec(vece, d, d, a);
 +}
 +
 +const GVecGen2i ssra_op[4] = {
 +    { .fni8 = gen_ssra8_i64,
 +      .fniv = gen_ssra_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_sari_vec,
 +      .vece = MO_8 },
 +    { .fni8 = gen_ssra16_i64,
 +      .fniv = gen_ssra_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_sari_vec,
 +      .vece = MO_16 },
 +    { .fni4 = gen_ssra32_i32,
 +      .fniv = gen_ssra_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_sari_vec,
 +      .vece = MO_32 },
 +    { .fni8 = gen_ssra64_i64,
 +      .fniv = gen_ssra_vec,
 +      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 +      .load_dest = true,
 +      .opc = INDEX_op_sari_vec,
 +      .vece = MO_64 },
 +};
 +
 +static void gen_usra8_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    tcg_gen_vec_shr8i_i64(a, a, shift);
 +    tcg_gen_vec_add8_i64(d, d, a);
 +}
 +
 +static void gen_usra16_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    tcg_gen_vec_shr16i_i64(a, a, shift);
 +    tcg_gen_vec_add16_i64(d, d, a);
 +}
 +
 +static void gen_usra32_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
 +{
 +    tcg_gen_shri_i32(a, a, shift);
 +    tcg_gen_add_i32(d, d, a);
 +}
 +
 +static void gen_usra64_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    tcg_gen_shri_i64(a, a, shift);
 +    tcg_gen_add_i64(d, d, a);
 +}
 +
 +static void gen_usra_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
 +{
 +    tcg_gen_shri_vec(vece, a, a, sh);
 +    tcg_gen_add_vec(vece, d, d, a);
 +}
 +
 +const GVecGen2i usra_op[4] = {
 +    { .fni8 = gen_usra8_i64,
 +      .fniv = gen_usra_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_shri_vec,
 +      .vece = MO_8, },
 +    { .fni8 = gen_usra16_i64,
 +      .fniv = gen_usra_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_shri_vec,
 +      .vece = MO_16, },
 +    { .fni4 = gen_usra32_i32,
 +      .fniv = gen_usra_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_shri_vec,
 +      .vece = MO_32, },
 +    { .fni8 = gen_usra64_i64,
 +      .fniv = gen_usra_vec,
 +      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 +      .load_dest = true,
 +      .opc = INDEX_op_shri_vec,
 +      .vece = MO_64, },
 +};
  /* Translate a NEON data processing instruction.  Return nonzero if the
     instruction is invalid.
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                      }
                      return 0;
 +                case 1:  /* VSRA */
 +                    /* Right shift comes here negative.  */
 +                    shift = -shift;
 +                    /* Shifts larger than the element size are architecturally
 +                     * valid.  Unsigned results in all zeros; signed results
 +                     * in all sign bits.
 +                     */
 +                    if (!u) {
 +                        tcg_gen_gvec_2i(rd_ofs, rm_ofs, vec_size, vec_size,
 +                                        MIN(shift, (8 << size) - 1),
 +                                        &ssra_op[size]);
 +                    } else if (shift >= 8 << size) {
 +                        /* rd += 0 */
 +                    } else {
 +                        tcg_gen_gvec_2i(rd_ofs, rm_ofs, vec_size, vec_size,
 +                                        shift, &usra_op[size]);
 +                    }
 +                    return 0;
 +
                  case 5: /* VSHL, VSLI */
                      if (!u) { /* VSHL */
                          /* Shifts larger than the element size are
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                          neon_load_reg64(cpu_V0, rm + pass);
                          tcg_gen_movi_i64(cpu_V1, imm);
                          switch (op) {
 -                        case 1:  /* VSRA */
 -                            if (u)
 -                                gen_helper_neon_shl_u64(cpu_V0, cpu_V0, cpu_V1);
 -                            else
 -                                gen_helper_neon_shl_s64(cpu_V0, cpu_V0, cpu_V1);
 -                            break;
                          case 2: /* VRSHR */
                          case 3: /* VRSRA */
                              if (u)
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                          default:
                              g_assert_not_reached();
                          }
 -                        if (op == 1 || op == 3) {
 +                        if (op == 3) {
                              /* Accumulate.  */
                              neon_load_reg64(cpu_V1, rd + pass);
                              tcg_gen_add_i64(cpu_V0, cpu_V0, cpu_V1);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                          tmp2 = tcg_temp_new_i32();
                          tcg_gen_movi_i32(tmp2, imm);
                          switch (op) {
 -                        case 1:  /* VSRA */
 -                            GEN_NEON_INTEGER_OP(shl);
 -                            break;
                          case 2: /* VRSHR */
                          case 3: /* VRSRA */
                              GEN_NEON_INTEGER_OP(rshl);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                          }
                          tcg_temp_free_i32(tmp2);
 -                        if (op == 1 || op == 3) {
 +                        if (op == 3) {
                              /* Accumulate.  */
                              tmp2 = neon_load_reg(rd, pass);
                              gen_neon_add(size, tmp, tmp2);
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 23/45] target/arm: Don't call tcg_clear_temp_count
+[PULL 17/54] target/arm: Use tcg_constant in disas_fp*
 From: Richard Henderson <richard.henderson@linaro.org>
-This is done generically in translator_loop.
-Reported-by: Laurent Desnogues <laurent.desnogues@gmail.com>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
-Message-id: 20181011205206.3552-3-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-18-richard.henderson@linaro.org
+[PMM: Restore incorrectly removed free of t_false in disas_fp_csel()]
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate-a64.c | 1 -
+ target/arm/translate-a64.c | 23 +++++++----------------
- target/arm/translate.c     | 1 -
+file changed, 7 insertions(+), 16 deletions(-)
 files changed, 2 deletions(-)
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
-@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_init_disas_context(DisasContextBase *dcbase,
+@@ -XXX,XX +XXX,XX @@ static void handle_fp_compare(DisasContext *s, int size,
- static void aarch64_tr_tb_start(DisasContextBase *db, CPUState *cpu)
+         tcg_vn = read_fp_dreg(s, rn);
          if (cmp_with_zero) {
 -            tcg_vm = tcg_const_i64(0);
 +            tcg_vm = tcg_constant_i64(0);
          } else {
              tcg_vm = read_fp_dreg(s, rm);
          }
@@ -XXX,XX +XXX,XX @@ static void disas_fp_compare(DisasContext *s, uint32_t insn)
  static void disas_fp_ccomp(DisasContext *s, uint32_t insn)
  {
--    tcg_clear_temp_count();
+     unsigned int mos, type, rm, cond, rn, op, nzcv;
 -    TCGv_i64 tcg_flags;
      TCGLabel *label_continue = NULL;
      int size;
@@ -XXX,XX +XXX,XX @@ static void disas_fp_ccomp(DisasContext *s, uint32_t insn)
          label_continue = gen_new_label();
          arm_gen_test_cc(cond, label_match);
          /* nomatch: */
 -        tcg_flags = tcg_const_i64(nzcv << 28);
 -        gen_set_nzcv(tcg_flags);
 -        tcg_temp_free_i64(tcg_flags);
 +        gen_set_nzcv(tcg_constant_i64(nzcv << 28));
          tcg_gen_br(label_continue);
          gen_set_label(label_match);
      }
@@ -XXX,XX +XXX,XX @@ static void disas_fp_ccomp(DisasContext *s, uint32_t insn)
  static void disas_fp_csel(DisasContext *s, uint32_t insn)
  {
      unsigned int mos, type, rm, cond, rn, rd;
 -    TCGv_i64 t_true, t_false, t_zero;
 +    TCGv_i64 t_true, t_false;
      DisasCompare64 c;
      MemOp sz;
@@ -XXX,XX +XXX,XX @@ static void disas_fp_csel(DisasContext *s, uint32_t insn)
      read_vec_element(s, t_false, rm, 0, sz);
      a64_test_cc(&c, cond);
 -    t_zero = tcg_const_i64(0);
 -    tcg_gen_movcond_i64(c.cond, t_true, c.value, t_zero, t_true, t_false);
 -    tcg_temp_free_i64(t_zero);
 +    tcg_gen_movcond_i64(c.cond, t_true, c.value, tcg_constant_i64(0),
 +                        t_true, t_false);
      tcg_temp_free_i64(t_false);
      a64_free_cc(&c);
@@ -XXX,XX +XXX,XX @@ static void disas_fp_imm(DisasContext *s, uint32_t insn)
      int type = extract32(insn, 22, 2);
      int mos = extract32(insn, 29, 3);
      uint64_t imm;
 -    TCGv_i64 tcg_res;
      MemOp sz;
      if (mos || imm5) {
@@ -XXX,XX +XXX,XX @@ static void disas_fp_imm(DisasContext *s, uint32_t insn)
      }
      imm = vfp_expand_imm(sz, imm8);
 -
 -    tcg_res = tcg_const_i64(imm);
 -    write_fp_dreg(s, rd, tcg_res);
 -    tcg_temp_free_i64(tcg_res);
 +    write_fp_dreg(s, rd, tcg_constant_i64(imm));
  }
- static void aarch64_tr_insn_start(DisasContextBase *dcbase, CPUState *cpu)
+ /* Handle floating point <=> fixed point conversions. Note that we can
-diff --git a/target/arm/translate.c b/target/arm/translate.c
+@@ -XXX,XX +XXX,XX @@ static void handle_fpfpcvt(DisasContext *s, int rd, int rn, int opcode,
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
+     tcg_fpstatus = fpstatus_ptr(type == 3 ? FPST_FPCR_F16 : FPST_FPCR);
-+++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static void arm_tr_tb_start(DisasContextBase *dcbase, CPUState *cpu)
+-    tcg_shift = tcg_const_i32(64 - scale);
-         tcg_gen_movi_i32(tmp, 0);
++    tcg_shift = tcg_constant_i32(64 - scale);
-         store_cpu_field(tmp, condexec_bits);
      if (itof) {
          TCGv_i64 tcg_int = cpu_reg(s, rn);
@@ -XXX,XX +XXX,XX @@ static void handle_fpfpcvt(DisasContext *s, int rd, int rn, int opcode,
      }
--    tcg_clear_temp_count();
      tcg_temp_free_ptr(tcg_fpstatus);
 -    tcg_temp_free_i32(tcg_shift);
  }
- static void arm_tr_insn_start(DisasContextBase *dcbase, CPUState *cpu)
+ /* Floating point <-> fixed point conversions
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 02/45] target/arm: Add support for VCPU event states
+[PULL 18/54] target/arm: Use tcg_constant in simd shift expanders
-From: Dongjiu Geng <gengdongjiu@huawei.com>
+From: Richard Henderson <richard.henderson@linaro.org>
-This patch extends the qemu-kvm state sync logic with support for
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 KVM_GET/SET_VCPU_EVENTS, giving access to yet missing SError exception.
 And also it can support the exception state migration.
 The SError exception states include SError pending state and ESR value,
 the kvm_put/get_vcpu_events() will be called when set or get system
 registers. When do migration, if source machine has SError pending,
 QEMU will do this migration regardless whether the target machine supports
 to specify guest ESR value, because if target machine does not support that,
 it can also inject the SError with zero ESR value.
 Signed-off-by: Dongjiu Geng <gengdongjiu@huawei.com>
 Reviewed-by: Andrew Jones <drjones@redhat.com>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Message-id: 1538067351-23931-3-git-send-email-gengdongjiu@huawei.com
+Message-id: 20220426163043.100432-19-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.h     |  7 ++++++
+ target/arm/translate-a64.c | 21 +++++----------------
- target/arm/kvm_arm.h | 24 ++++++++++++++++++
+file changed, 5 insertions(+), 16 deletions(-)
  target/arm/kvm.c     | 60 ++++++++++++++++++++++++++++++++++++++++++++
  target/arm/kvm32.c   | 13 ++++++++++
  target/arm/kvm64.c   | 13 ++++++++++
  target/arm/machine.c | 22 ++++++++++++++++
 files changed, 139 insertions(+)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
+diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/target/arm/translate-a64.c
-+++ b/target/arm/cpu.h
++++ b/target/arm/translate-a64.c
-@@ -XXX,XX +XXX,XX @@ typedef struct CPUARMState {
+@@ -XXX,XX +XXX,XX @@ static void handle_shri_with_rndacc(TCGv_i64 tcg_res, TCGv_i64 tcg_src,
-          */
+     /* Deal with the rounding step */
-     } exception;
+     if (round) {
+         if (extended_result) {
-+    /* Information associated with an SError */
+-            TCGv_i64 tcg_zero = tcg_const_i64(0);
-+    struct {
++            TCGv_i64 tcg_zero = tcg_constant_i64(0);
-+        uint8_t pending;
+             if (!is_u) {
-+        uint8_t has_esr;
+                 /* take care of sign extending tcg_res */
-+        uint64_t esr;
+                 tcg_gen_sari_i64(tcg_src_hi, tcg_src, 63);
-+    } serror;
+@@ -XXX,XX +XXX,XX @@ static void handle_shri_with_rndacc(TCGv_i64 tcg_res, TCGv_i64 tcg_src,
-+
+                                  tcg_src, tcg_zero,
-     /* Thumb-2 EE state.  */
+                                  tcg_rnd, tcg_zero);
-     uint32_t teecr;
+             }
-     uint32_t teehbr;
+-            tcg_temp_free_i64(tcg_zero);
-diff --git a/target/arm/kvm_arm.h b/target/arm/kvm_arm.h
+         } else {
-index XXXXXXX..XXXXXXX 100644
+             tcg_gen_add_i64(tcg_src, tcg_src, tcg_rnd);
---- a/target/arm/kvm_arm.h
+         }
-+++ b/target/arm/kvm_arm.h
+@@ -XXX,XX +XXX,XX @@ static void handle_scalar_simd_shri(DisasContext *s,
-@@ -XXX,XX +XXX,XX @@ bool write_kvmstate_to_list(ARMCPU *cpu);
+     }
-  */
- void kvm_arm_reset_vcpu(ARMCPU *cpu);
+     if (round) {
+-        uint64_t round_const = 1ULL << (shift - 1);
-+/**
+-        tcg_round = tcg_const_i64(round_const);
-+ * kvm_arm_init_serror_injection:
++        tcg_round = tcg_constant_i64(1ULL << (shift - 1));
-+ * @cs: CPUState
+     } else {
-+ *
+         tcg_round = NULL;
-+ * Check whether KVM can set guest SError syndrome.
+     }
-+ */
+@@ -XXX,XX +XXX,XX @@ static void handle_scalar_simd_shri(DisasContext *s,
-+void kvm_arm_init_serror_injection(CPUState *cs);
-+
+     tcg_temp_free_i64(tcg_rn);
-+/**
+     tcg_temp_free_i64(tcg_rd);
-+ * kvm_get_vcpu_events:
+-    if (round) {
-+ * @cpu: ARMCPU
+-        tcg_temp_free_i64(tcg_round);
-+ *
+-    }
 + * Get VCPU related state from kvm.
 + */
 +int kvm_get_vcpu_events(ARMCPU *cpu);
 +
 +/**
 + * kvm_put_vcpu_events:
 + * @cpu: ARMCPU
 + *
 + * Put VCPU related state to kvm.
 + */
 +int kvm_put_vcpu_events(ARMCPU *cpu);
 +
  #ifdef CONFIG_KVM
  /**
   * kvm_arm_create_scratch_host_vcpu:
 diff --git a/target/arm/kvm.c b/target/arm/kvm.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/kvm.c
 +++ b/target/arm/kvm.c
@@ -XXX,XX +XXX,XX @@ const KVMCapabilityInfo kvm_arch_required_capabilities[] = {
  };
  static bool cap_has_mp_state;
 +static bool cap_has_inject_serror_esr;
  static ARMHostCPUFeatures arm_host_cpu_features;
@@ -XXX,XX +XXX,XX @@ int kvm_arm_vcpu_init(CPUState *cs)
      return kvm_vcpu_ioctl(cs, KVM_ARM_VCPU_INIT, &init);
  }
-+void kvm_arm_init_serror_injection(CPUState *cs)
+ /* SHL/SLI - Scalar shift left */
-+{
+@@ -XXX,XX +XXX,XX @@ static void handle_vec_simd_sqshrn(DisasContext *s, bool is_scalar, bool is_q,
-+    cap_has_inject_serror_esr = kvm_check_extension(cs->kvm_state,
+     tcg_final = tcg_const_i64(0);
-+                                    KVM_CAP_ARM_INJECT_SERROR_ESR);
-+}
+     if (round) {
-+
+-        uint64_t round_const = 1ULL << (shift - 1);
- bool kvm_arm_create_scratch_host_vcpu(const uint32_t *cpus_to_try,
+-        tcg_round = tcg_const_i64(round_const);
-                                       int *fdarray,
++        tcg_round = tcg_constant_i64(1ULL << (shift - 1));
-                                       struct kvm_vcpu_init *init)
+     } else {
-@@ -XXX,XX +XXX,XX @@ int kvm_arm_sync_mpstate_to_qemu(ARMCPU *cpu)
+         tcg_round = NULL;
      return 0;
  }
 +int kvm_put_vcpu_events(ARMCPU *cpu)
 +{
 +    CPUARMState *env = &cpu->env;
 +    struct kvm_vcpu_events events;
 +    int ret;
 +
 +    if (!kvm_has_vcpu_events()) {
 +        return 0;
 +    }
 +
 +    memset(&events, 0, sizeof(events));
 +    events.exception.serror_pending = env->serror.pending;
 +
 +    /* Inject SError to guest with specified syndrome if host kernel
 +     * supports it, otherwise inject SError without syndrome.
 +     */
 +    if (cap_has_inject_serror_esr) {
 +        events.exception.serror_has_esr = env->serror.has_esr;
 +        events.exception.serror_esr = env->serror.esr;
 +    }
 +
 +    ret = kvm_vcpu_ioctl(CPU(cpu), KVM_SET_VCPU_EVENTS, &events);
 +    if (ret) {
 +        error_report("failed to put vcpu events");
 +    }
 +
 +    return ret;
 +}
 +
 +int kvm_get_vcpu_events(ARMCPU *cpu)
 +{
 +    CPUARMState *env = &cpu->env;
 +    struct kvm_vcpu_events events;
 +    int ret;
 +
 +    if (!kvm_has_vcpu_events()) {
 +        return 0;
 +    }
 +
 +    memset(&events, 0, sizeof(events));
 +    ret = kvm_vcpu_ioctl(CPU(cpu), KVM_GET_VCPU_EVENTS, &events);
 +    if (ret) {
 +        error_report("failed to get vcpu events");
 +        return ret;
 +    }
 +
 +    env->serror.pending = events.exception.serror_pending;
 +    env->serror.has_esr = events.exception.serror_has_esr;
 +    env->serror.esr = events.exception.serror_esr;
 +
 +    return 0;
 +}
 +
  void kvm_arch_pre_run(CPUState *cs, struct kvm_run *run)
  {
  }
 diff --git a/target/arm/kvm32.c b/target/arm/kvm32.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/kvm32.c
 +++ b/target/arm/kvm32.c
@@ -XXX,XX +XXX,XX @@ int kvm_arch_init_vcpu(CPUState *cs)
      }
-     cpu->mp_affinity = mpidr & ARM32_AFFINITY_MASK;
+@@ -XXX,XX +XXX,XX @@ static void handle_vec_simd_sqshrn(DisasContext *s, bool is_scalar, bool is_q,
+         write_vec_element(s, tcg_final, rd, 1, MO_64);
 +    /* Check whether userspace can specify guest syndrome value */
 +    kvm_arm_init_serror_injection(cs);
 +
      return kvm_arm_init_cpreg_list(cpu);
  }
@@ -XXX,XX +XXX,XX @@ int kvm_arch_put_registers(CPUState *cs, int level)
          return ret;
      }
-+    ret = kvm_put_vcpu_events(cpu);
+-    if (round) {
-+    if (ret) {
+-        tcg_temp_free_i64(tcg_round);
-+        return ret;
+-    }
-+    }
+     tcg_temp_free_i64(tcg_rn);
-+
+     tcg_temp_free_i64(tcg_rd);
-     /* Note that we do not call write_cpustate_to_list()
+     tcg_temp_free_i32(tcg_rd_narrowed);
-      * here, so we are only writing the tuple list back to
+@@ -XXX,XX +XXX,XX @@ static void handle_simd_qshl(DisasContext *s, bool scalar, bool is_q,
       * KVM. This is safe because nothing can change the
@@ -XXX,XX +XXX,XX @@ int kvm_arch_get_registers(CPUState *cs)
      }
-     vfp_set_fpscr(env, fpscr);
+     if (size == 3) {
-+    ret = kvm_get_vcpu_events(cpu);
+-        TCGv_i64 tcg_shift = tcg_const_i64(shift);
-+    if (ret) {
++        TCGv_i64 tcg_shift = tcg_constant_i64(shift);
-+        return ret;
+         static NeonGenTwo64OpEnvFn * const fns[2][2] = {
-+    }
+             { gen_helper_neon_qshl_s64, gen_helper_neon_qshlu_s64 },
-+
+             { NULL, gen_helper_neon_qshl_u64 },
-     if (!write_kvmstate_to_list(cpu)) {
+@@ -XXX,XX +XXX,XX @@ static void handle_simd_qshl(DisasContext *s, bool scalar, bool is_q,
-         return EINVAL;
-     }
+             tcg_temp_free_i64(tcg_op);
-diff --git a/target/arm/kvm64.c b/target/arm/kvm64.c
+         }
-index XXXXXXX..XXXXXXX 100644
+-        tcg_temp_free_i64(tcg_shift);
---- a/target/arm/kvm64.c
+         clear_vec_high(s, is_q, rd);
-+++ b/target/arm/kvm64.c
+     } else {
-@@ -XXX,XX +XXX,XX @@ int kvm_arch_init_vcpu(CPUState *cs)
+-        TCGv_i32 tcg_shift = tcg_const_i32(shift);
++        TCGv_i32 tcg_shift = tcg_constant_i32(shift);
-     kvm_arm_init_debug(cs);
+         static NeonGenTwoOpEnvFn * const fns[2][2][3] = {
+             {
-+    /* Check whether user space can specify guest syndrome value */
+                 { gen_helper_neon_qshl_s8,
-+    kvm_arm_init_serror_injection(cs);
+@@ -XXX,XX +XXX,XX @@ static void handle_simd_qshl(DisasContext *s, bool scalar, bool is_q,
-+
-     return kvm_arm_init_cpreg_list(cpu);
+             tcg_temp_free_i32(tcg_op);
- }
+         }
+-        tcg_temp_free_i32(tcg_shift);
-@@ -XXX,XX +XXX,XX @@ int kvm_arch_put_registers(CPUState *cs, int level)
-         return ret;
+         if (!scalar) {
-     }
+             clear_vec_high(s, is_q, rd);
 +    ret = kvm_put_vcpu_events(cpu);
 +    if (ret) {
 +        return ret;
 +    }
 +
      if (!write_list_to_kvmstate(cpu, level)) {
          return EINVAL;
      }
@@ -XXX,XX +XXX,XX @@ int kvm_arch_get_registers(CPUState *cs)
      }
      vfp_set_fpcr(env, fpr);
 +    ret = kvm_get_vcpu_events(cpu);
 +    if (ret) {
 +        return ret;
 +    }
 +
      if (!write_kvmstate_to_list(cpu)) {
          return EINVAL;
      }
 diff --git a/target/arm/machine.c b/target/arm/machine.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/machine.c
 +++ b/target/arm/machine.c
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_sve = {
  };
  #endif /* AARCH64 */
 +static bool serror_needed(void *opaque)
 +{
 +    ARMCPU *cpu = opaque;
 +    CPUARMState *env = &cpu->env;
 +
 +    return env->serror.pending != 0;
 +}
 +
 +static const VMStateDescription vmstate_serror = {
 +    .name = "cpu/serror",
 +    .version_id = 1,
 +    .minimum_version_id = 1,
 +    .needed = serror_needed,
 +    .fields = (VMStateField[]) {
 +        VMSTATE_UINT8(env.serror.pending, ARMCPU),
 +        VMSTATE_UINT8(env.serror.has_esr, ARMCPU),
 +        VMSTATE_UINT64(env.serror.esr, ARMCPU),
 +        VMSTATE_END_OF_LIST()
 +    }
 +};
 +
  static bool m_needed(void *opaque)
  {
      ARMCPU *cpu = opaque;
@@ -XXX,XX +XXX,XX @@ const VMStateDescription vmstate_arm_cpu = {
  #ifdef TARGET_AARCH64
          &vmstate_sve,
  #endif
 +        &vmstate_serror,
          NULL
      }
  };
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 05/45] target/arm: Convert v8 extensions from feature bits to isar tests
+[PULL 19/54] target/arm: Use tcg_constant in simd fp/int conversion
 From: Richard Henderson <richard.henderson@linaro.org>
-Most of the v8 extensions are self-contained within the ISAR
-registers and are not implied by other feature bits, which
-makes them the easiest to convert.
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181016223115.24100-4-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-20-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.h           | 131 +++++++++++++++++++++++++++++++++----
+ target/arm/translate-a64.c | 26 ++++++--------------------
- target/arm/translate.h     |   7 ++
+file changed, 6 insertions(+), 20 deletions(-)
  linux-user/elfload.c       |  46 ++++++++-----
  target/arm/cpu.c           |  27 +++++---
  target/arm/cpu64.c         |  57 +++++++++-------
  target/arm/translate-a64.c | 101 ++++++++++++++--------------
  target/arm/translate.c     |  36 +++++-----
 files changed, 273 insertions(+), 132 deletions(-)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
-+++ b/target/arm/cpu.h
-@@ -XXX,XX +XXX,XX @@ typedef enum ARMPSCIState {
-     PSCI_ON_PENDING = 2
- } ARMPSCIState;
-+typedef struct ARMISARegisters ARMISARegisters;
-+
- /**
-  * ARMCPU:
-  * @env: #CPUARMState
-@@ -XXX,XX +XXX,XX @@ enum arm_features {
-     ARM_FEATURE_LPAE, /* has Large Physical Address Extension */
-     ARM_FEATURE_V8,
-     ARM_FEATURE_AARCH64, /* supports 64 bit mode */
--    ARM_FEATURE_V8_AES, /* implements AES part of v8 Crypto Extensions */
-     ARM_FEATURE_CBAR, /* has cp15 CBAR */
-     ARM_FEATURE_CRC, /* ARMv8 CRC instructions */
-     ARM_FEATURE_CBAR_RO, /* has cp15 CBAR and it is read-only */
-     ARM_FEATURE_EL2, /* has EL2 Virtualization support */
-     ARM_FEATURE_EL3, /* has EL3 Secure monitor support */
--    ARM_FEATURE_V8_SHA1, /* implements SHA1 part of v8 Crypto Extensions */
--    ARM_FEATURE_V8_SHA256, /* implements SHA256 part of v8 Crypto Extensions */
--    ARM_FEATURE_V8_PMULL, /* implements PMULL part of v8 Crypto Extensions */
-     ARM_FEATURE_THUMB_DSP, /* DSP insns supported in the Thumb encodings */
-     ARM_FEATURE_PMU, /* has PMU support */
-     ARM_FEATURE_VBAR, /* has cp15 VBAR */
-     ARM_FEATURE_M_SECURITY, /* M profile Security Extension */
-     ARM_FEATURE_JAZELLE, /* has (trivial) Jazelle implementation */
-     ARM_FEATURE_SVE, /* has Scalable Vector Extension */
--    ARM_FEATURE_V8_SHA512, /* implements SHA512 part of v8 Crypto Extensions */
--    ARM_FEATURE_V8_SHA3, /* implements SHA3 part of v8 Crypto Extensions */
--    ARM_FEATURE_V8_SM3, /* implements SM3 part of v8 Crypto Extensions */
--    ARM_FEATURE_V8_SM4, /* implements SM4 part of v8 Crypto Extensions */
--    ARM_FEATURE_V8_ATOMICS, /* ARMv8.1-Atomics feature */
--    ARM_FEATURE_V8_RDM, /* implements v8.1 simd round multiply */
--    ARM_FEATURE_V8_DOTPROD, /* implements v8.2 simd dot product */
-     ARM_FEATURE_V8_FP16, /* implements v8.2 half-precision float */
--    ARM_FEATURE_V8_FCMA, /* has complex number part of v8.3 extensions.  */
-     ARM_FEATURE_M_MAIN, /* M profile Main Extension */
- };
-@@ -XXX,XX +XXX,XX @@ static inline uint64_t *aa64_vfp_qreg(CPUARMState *env, unsigned regno)
- /* Shared between translate-sve.c and sve_helper.c.  */
- extern const uint64_t pred_esz_masks[4];
-+/*
-+ * 32-bit feature tests via id registers.
-+ */
-+static inline bool isar_feature_aa32_aes(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) != 0;
-+}
-+
-+static inline bool isar_feature_aa32_pmull(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) > 1;
-+}
-+
-+static inline bool isar_feature_aa32_sha1(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar5, ID_ISAR5, SHA1) != 0;
-+}
-+
-+static inline bool isar_feature_aa32_sha2(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar5, ID_ISAR5, SHA2) != 0;
-+}
-+
-+static inline bool isar_feature_aa32_crc32(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar5, ID_ISAR5, CRC32) != 0;
-+}
-+
-+static inline bool isar_feature_aa32_rdm(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar5, ID_ISAR5, RDM) != 0;
-+}
-+
-+static inline bool isar_feature_aa32_vcma(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar5, ID_ISAR5, VCMA) != 0;
-+}
-+
-+static inline bool isar_feature_aa32_dp(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar6, ID_ISAR6, DP) != 0;
-+}
-+
-+/*
-+ * 64-bit feature tests via id registers.
-+ */
-+static inline bool isar_feature_aa64_aes(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, AES) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_pmull(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, AES) > 1;
-+}
-+
-+static inline bool isar_feature_aa64_sha1(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SHA1) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_sha256(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SHA2) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_sha512(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SHA2) > 1;
-+}
-+
-+static inline bool isar_feature_aa64_crc32(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, CRC32) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_atomics(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, ATOMIC) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_rdm(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, RDM) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_sha3(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SHA3) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_sm3(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SM3) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_sm4(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SM4) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_dp(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, DP) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_fcma(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar1, ID_AA64ISAR1, FCMA) != 0;
-+}
-+
-+/*
-+ * Forward to the above feature tests given an ARMCPU pointer.
-+ */
-+#define cpu_isar_feature(name, cpu) \
-+    ({ ARMCPU *cpu_ = (cpu); isar_feature_##name(&cpu_->isar); })
-+
- #endif
-diff --git a/target/arm/translate.h b/target/arm/translate.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.h
-+++ b/target/arm/translate.h
-@@ -XXX,XX +XXX,XX @@
- /* internal defines */
- typedef struct DisasContext {
-     DisasContextBase base;
-+    const ARMISARegisters *isar;
-     target_ulong pc;
-     target_ulong page_start;
-@@ -XXX,XX +XXX,XX @@ static inline TCGv_i32 get_ahp_flag(void)
-     return ret;
- }
-+/*
-+ * Forward to the isar_feature_* tests given a DisasContext pointer.
-+ */
-+#define dc_isar_feature(name, ctx) \
-+    ({ DisasContext *ctx_ = (ctx); isar_feature_##name(ctx_->isar); })
-+
- #endif /* TARGET_ARM_TRANSLATE_H */
-diff --git a/linux-user/elfload.c b/linux-user/elfload.c
-index XXXXXXX..XXXXXXX 100644
---- a/linux-user/elfload.c
-+++ b/linux-user/elfload.c
-@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
-     /* probe for the extra features */
- #define GET_FEATURE(feat, hwcap) \
-     do { if (arm_feature(&cpu->env, feat)) { hwcaps |= hwcap; } } while (0)
-+
-+#define GET_FEATURE_ID(feat, hwcap) \
-+    do { if (cpu_isar_feature(feat, cpu)) { hwcaps |= hwcap; } } while (0)
-+
-     /* EDSP is in v5TE and above, but all our v5 CPUs are v5TE */
-     GET_FEATURE(ARM_FEATURE_V5, ARM_HWCAP_ARM_EDSP);
-     GET_FEATURE(ARM_FEATURE_VFP, ARM_HWCAP_ARM_VFP);
-@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap2(void)
-     ARMCPU *cpu = ARM_CPU(thread_cpu);
-     uint32_t hwcaps = 0;
--    GET_FEATURE(ARM_FEATURE_V8_AES, ARM_HWCAP2_ARM_AES);
--    GET_FEATURE(ARM_FEATURE_V8_PMULL, ARM_HWCAP2_ARM_PMULL);
--    GET_FEATURE(ARM_FEATURE_V8_SHA1, ARM_HWCAP2_ARM_SHA1);
--    GET_FEATURE(ARM_FEATURE_V8_SHA256, ARM_HWCAP2_ARM_SHA2);
--    GET_FEATURE(ARM_FEATURE_CRC, ARM_HWCAP2_ARM_CRC32);
-+    GET_FEATURE_ID(aa32_aes, ARM_HWCAP2_ARM_AES);
-+    GET_FEATURE_ID(aa32_pmull, ARM_HWCAP2_ARM_PMULL);
-+    GET_FEATURE_ID(aa32_sha1, ARM_HWCAP2_ARM_SHA1);
-+    GET_FEATURE_ID(aa32_sha2, ARM_HWCAP2_ARM_SHA2);
-+    GET_FEATURE_ID(aa32_crc32, ARM_HWCAP2_ARM_CRC32);
-     return hwcaps;
- }
- #undef GET_FEATURE
-+#undef GET_FEATURE_ID
- #else
- /* 64 bit ARM definitions */
-@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
-     /* probe for the extra features */
- #define GET_FEATURE(feat, hwcap) \
-     do { if (arm_feature(&cpu->env, feat)) { hwcaps |= hwcap; } } while (0)
--    GET_FEATURE(ARM_FEATURE_V8_AES, ARM_HWCAP_A64_AES);
--    GET_FEATURE(ARM_FEATURE_V8_PMULL, ARM_HWCAP_A64_PMULL);
--    GET_FEATURE(ARM_FEATURE_V8_SHA1, ARM_HWCAP_A64_SHA1);
--    GET_FEATURE(ARM_FEATURE_V8_SHA256, ARM_HWCAP_A64_SHA2);
--    GET_FEATURE(ARM_FEATURE_CRC, ARM_HWCAP_A64_CRC32);
--    GET_FEATURE(ARM_FEATURE_V8_SHA3, ARM_HWCAP_A64_SHA3);
--    GET_FEATURE(ARM_FEATURE_V8_SM3, ARM_HWCAP_A64_SM3);
--    GET_FEATURE(ARM_FEATURE_V8_SM4, ARM_HWCAP_A64_SM4);
--    GET_FEATURE(ARM_FEATURE_V8_SHA512, ARM_HWCAP_A64_SHA512);
-+#define GET_FEATURE_ID(feat, hwcap) \
-+    do { if (cpu_isar_feature(feat, cpu)) { hwcaps |= hwcap; } } while (0)
-+
-+    GET_FEATURE_ID(aa64_aes, ARM_HWCAP_A64_AES);
-+    GET_FEATURE_ID(aa64_pmull, ARM_HWCAP_A64_PMULL);
-+    GET_FEATURE_ID(aa64_sha1, ARM_HWCAP_A64_SHA1);
-+    GET_FEATURE_ID(aa64_sha256, ARM_HWCAP_A64_SHA2);
-+    GET_FEATURE_ID(aa64_sha512, ARM_HWCAP_A64_SHA512);
-+    GET_FEATURE_ID(aa64_crc32, ARM_HWCAP_A64_CRC32);
-+    GET_FEATURE_ID(aa64_sha3, ARM_HWCAP_A64_SHA3);
-+    GET_FEATURE_ID(aa64_sm3, ARM_HWCAP_A64_SM3);
-+    GET_FEATURE_ID(aa64_sm4, ARM_HWCAP_A64_SM4);
-     GET_FEATURE(ARM_FEATURE_V8_FP16,
-                 ARM_HWCAP_A64_FPHP | ARM_HWCAP_A64_ASIMDHP);
--    GET_FEATURE(ARM_FEATURE_V8_ATOMICS, ARM_HWCAP_A64_ATOMICS);
--    GET_FEATURE(ARM_FEATURE_V8_RDM, ARM_HWCAP_A64_ASIMDRDM);
--    GET_FEATURE(ARM_FEATURE_V8_DOTPROD, ARM_HWCAP_A64_ASIMDDP);
--    GET_FEATURE(ARM_FEATURE_V8_FCMA, ARM_HWCAP_A64_FCMA);
-+    GET_FEATURE_ID(aa64_atomics, ARM_HWCAP_A64_ATOMICS);
-+    GET_FEATURE_ID(aa64_rdm, ARM_HWCAP_A64_ASIMDRDM);
-+    GET_FEATURE_ID(aa64_dp, ARM_HWCAP_A64_ASIMDDP);
-+    GET_FEATURE_ID(aa64_fcma, ARM_HWCAP_A64_FCMA);
-     GET_FEATURE(ARM_FEATURE_SVE, ARM_HWCAP_A64_SVE);
-+
- #undef GET_FEATURE
-+#undef GET_FEATURE_ID
-     return hwcaps;
- }
-diff --git a/target/arm/cpu.c b/target/arm/cpu.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.c
-+++ b/target/arm/cpu.c
-@@ -XXX,XX +XXX,XX @@ static void arm_max_initfn(Object *obj)
-         cortex_a15_initfn(obj);
- #ifdef CONFIG_USER_ONLY
-         /* We don't set these in system emulation mode for the moment,
--         * since we don't correctly set the ID registers to advertise them,
-+         * since we don't correctly set (all of) the ID registers to
-+         * advertise them.
-          */
-         set_feature(&cpu->env, ARM_FEATURE_V8);
--        set_feature(&cpu->env, ARM_FEATURE_V8_AES);
--        set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
--        set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
--        set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
--        set_feature(&cpu->env, ARM_FEATURE_CRC);
--        set_feature(&cpu->env, ARM_FEATURE_V8_RDM);
--        set_feature(&cpu->env, ARM_FEATURE_V8_DOTPROD);
--        set_feature(&cpu->env, ARM_FEATURE_V8_FCMA);
-+        {
-+            uint32_t t;
-+
-+            t = cpu->isar.id_isar5;
-+            t = FIELD_DP32(t, ID_ISAR5, AES, 2);
-+            t = FIELD_DP32(t, ID_ISAR5, SHA1, 1);
-+            t = FIELD_DP32(t, ID_ISAR5, SHA2, 1);
-+            t = FIELD_DP32(t, ID_ISAR5, CRC32, 1);
-+            t = FIELD_DP32(t, ID_ISAR5, RDM, 1);
-+            t = FIELD_DP32(t, ID_ISAR5, VCMA, 1);
-+            cpu->isar.id_isar5 = t;
-+
-+            t = cpu->isar.id_isar6;
-+            t = FIELD_DP32(t, ID_ISAR6, DP, 1);
-+            cpu->isar.id_isar6 = t;
-+        }
- #endif
-     }
- }
-diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu64.c
-+++ b/target/arm/cpu64.c
-@@ -XXX,XX +XXX,XX @@ static void aarch64_a57_initfn(Object *obj)
-     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
-     set_feature(&cpu->env, ARM_FEATURE_AARCH64);
-     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
--    set_feature(&cpu->env, ARM_FEATURE_V8_AES);
--    set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
--    set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
--    set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
--    set_feature(&cpu->env, ARM_FEATURE_CRC);
-     set_feature(&cpu->env, ARM_FEATURE_EL2);
-     set_feature(&cpu->env, ARM_FEATURE_EL3);
-     set_feature(&cpu->env, ARM_FEATURE_PMU);
-@@ -XXX,XX +XXX,XX @@ static void aarch64_a53_initfn(Object *obj)
-     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
-     set_feature(&cpu->env, ARM_FEATURE_AARCH64);
-     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
--    set_feature(&cpu->env, ARM_FEATURE_V8_AES);
--    set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
--    set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
--    set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
--    set_feature(&cpu->env, ARM_FEATURE_CRC);
-     set_feature(&cpu->env, ARM_FEATURE_EL2);
-     set_feature(&cpu->env, ARM_FEATURE_EL3);
-     set_feature(&cpu->env, ARM_FEATURE_PMU);
-@@ -XXX,XX +XXX,XX @@ static void aarch64_a72_initfn(Object *obj)
-     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
-     set_feature(&cpu->env, ARM_FEATURE_AARCH64);
-     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
--    set_feature(&cpu->env, ARM_FEATURE_V8_AES);
--    set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
--    set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
--    set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
--    set_feature(&cpu->env, ARM_FEATURE_CRC);
-     set_feature(&cpu->env, ARM_FEATURE_EL2);
-     set_feature(&cpu->env, ARM_FEATURE_EL3);
-     set_feature(&cpu->env, ARM_FEATURE_PMU);
-@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
-     if (kvm_enabled()) {
-         kvm_arm_set_cpu_features_from_host(cpu);
-     } else {
-+        uint64_t t;
-+        uint32_t u;
-         aarch64_a57_initfn(obj);
-+
-+        t = cpu->isar.id_aa64isar0;
-+        t = FIELD_DP64(t, ID_AA64ISAR0, AES, 2); /* AES + PMULL */
-+        t = FIELD_DP64(t, ID_AA64ISAR0, SHA1, 1);
-+        t = FIELD_DP64(t, ID_AA64ISAR0, SHA2, 2); /* SHA512 */
-+        t = FIELD_DP64(t, ID_AA64ISAR0, CRC32, 1);
-+        t = FIELD_DP64(t, ID_AA64ISAR0, ATOMIC, 2);
-+        t = FIELD_DP64(t, ID_AA64ISAR0, RDM, 1);
-+        t = FIELD_DP64(t, ID_AA64ISAR0, SHA3, 1);
-+        t = FIELD_DP64(t, ID_AA64ISAR0, SM3, 1);
-+        t = FIELD_DP64(t, ID_AA64ISAR0, SM4, 1);
-+        t = FIELD_DP64(t, ID_AA64ISAR0, DP, 1);
-+        cpu->isar.id_aa64isar0 = t;
-+
-+        t = cpu->isar.id_aa64isar1;
-+        t = FIELD_DP64(t, ID_AA64ISAR1, FCMA, 1);
-+        cpu->isar.id_aa64isar1 = t;
-+
-+        /* Replicate the same data to the 32-bit id registers.  */
-+        u = cpu->isar.id_isar5;
-+        u = FIELD_DP32(u, ID_ISAR5, AES, 2); /* AES + PMULL */
-+        u = FIELD_DP32(u, ID_ISAR5, SHA1, 1);
-+        u = FIELD_DP32(u, ID_ISAR5, SHA2, 1);
-+        u = FIELD_DP32(u, ID_ISAR5, CRC32, 1);
-+        u = FIELD_DP32(u, ID_ISAR5, RDM, 1);
-+        u = FIELD_DP32(u, ID_ISAR5, VCMA, 1);
-+        cpu->isar.id_isar5 = u;
-+
-+        u = cpu->isar.id_isar6;
-+        u = FIELD_DP32(u, ID_ISAR6, DP, 1);
-+        cpu->isar.id_isar6 = u;
-+
- #ifdef CONFIG_USER_ONLY
-         /* We don't set these in system emulation mode for the moment,
-          * since we don't correctly set the ID registers to advertise them,
-@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
-          * whereas the architecture requires them to be present in both if
-          * present in either.
-          */
--        set_feature(&cpu->env, ARM_FEATURE_V8_SHA512);
--        set_feature(&cpu->env, ARM_FEATURE_V8_SHA3);
--        set_feature(&cpu->env, ARM_FEATURE_V8_SM3);
--        set_feature(&cpu->env, ARM_FEATURE_V8_SM4);
--        set_feature(&cpu->env, ARM_FEATURE_V8_ATOMICS);
--        set_feature(&cpu->env, ARM_FEATURE_V8_RDM);
--        set_feature(&cpu->env, ARM_FEATURE_V8_DOTPROD);
-         set_feature(&cpu->env, ARM_FEATURE_V8_FP16);
--        set_feature(&cpu->env, ARM_FEATURE_V8_FCMA);
-         set_feature(&cpu->env, ARM_FEATURE_SVE);
-         /* For usermode -cpu max we can use a larger and more efficient DCZ
-          * blocksize since we don't have to follow what the hardware does.
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static void handle_simd_intfp_conv(DisasContext *s, int rd, int rn,
-         }
+     int pass;
-         if (rt2 == 31
-             && ((rt | rs) & 1) == 0
+     if (fracbits || size == MO_64) {
--            && arm_dc_feature(s, ARM_FEATURE_V8_ATOMICS)) {
+-        tcg_shift = tcg_const_i32(fracbits);
-+            && dc_isar_feature(aa64_atomics, s)) {
++        tcg_shift = tcg_constant_i32(fracbits);
              /* CASP / CASPL */
              gen_compare_and_swap_pair(s, rs, rt, rn, size | 2);
              return;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
          }
          if (rt2 == 31
              && ((rt | rs) & 1) == 0
 -            && arm_dc_feature(s, ARM_FEATURE_V8_ATOMICS)) {
 +            && dc_isar_feature(aa64_atomics, s)) {
              /* CASPA / CASPAL */
              gen_compare_and_swap_pair(s, rs, rt, rn, size | 2);
              return;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
      case 0xb: /* CASL */
      case 0xe: /* CASA */
      case 0xf: /* CASAL */
 -        if (rt2 == 31 && arm_dc_feature(s, ARM_FEATURE_V8_ATOMICS)) {
 +        if (rt2 == 31 && dc_isar_feature(aa64_atomics, s)) {
              gen_compare_and_swap(s, rs, rt, rn, size);
              return;
          }
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_atomic(DisasContext *s, uint32_t insn,
      int rs = extract32(insn, 16, 5);
      int rn = extract32(insn, 5, 5);
      int o3_opc = extract32(insn, 12, 4);
 -    int feature = ARM_FEATURE_V8_ATOMICS;
      TCGv_i64 tcg_rn, tcg_rs;
      AtomicThreeOpFn *fn;
 -    if (is_vector) {
 +    if (is_vector || !dc_isar_feature(aa64_atomics, s)) {
          unallocated_encoding(s);
          return;
      }
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_atomic(DisasContext *s, uint32_t insn,
-         unallocated_encoding(s);
+     if (size == MO_64) {
-         return;
+@@ -XXX,XX +XXX,XX @@ static void handle_simd_intfp_conv(DisasContext *s, int rd, int rn,
      }
--    if (!arm_dc_feature(s, feature)) {
--        unallocated_encoding(s);
+     tcg_temp_free_ptr(tcg_fpst);
--        return;
+-    if (tcg_shift) {
 -        tcg_temp_free_i32(tcg_shift);
 -    }
-     if (rn == 31) {
+     clear_vec_high(s, elements << size == 16, rd);
-         gen_check_sp_alignment(s);
+ }
-@@ -XXX,XX +XXX,XX @@ static void handle_crc32(DisasContext *s,
+@@ -XXX,XX +XXX,XX @@ static void handle_simd_shift_fpint_conv(DisasContext *s, bool is_scalar,
-     TCGv_i64 tcg_acc, tcg_val;
+     tcg_fpstatus = fpstatus_ptr(size == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
-     TCGv_i32 tcg_bytes;
+     gen_helper_set_rmode(tcg_rmode, tcg_rmode, tcg_fpstatus);
+     fracbits = (16 << size) - immhb;
--    if (!arm_dc_feature(s, ARM_FEATURE_CRC)
+-    tcg_shift = tcg_const_i32(fracbits);
-+    if (!dc_isar_feature(aa64_crc32, s)
++    tcg_shift = tcg_constant_i32(fracbits);
-         || (sf == 1 && sz != 3)
-         || (sf == 0 && sz == 3)) {
+     if (size == MO_64) {
-         unallocated_encoding(s);
+         int maxpass = is_scalar ? 1 : 2;
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_three_reg_same_extra(DisasContext *s,
+@@ -XXX,XX +XXX,XX @@ static void handle_simd_shift_fpint_conv(DisasContext *s, bool is_scalar,
      bool u = extract32(insn, 29, 1);
      TCGv_i32 ele1, ele2, ele3;
      TCGv_i64 res;
 -    int feature;
 +    bool feature;
      switch (u * 16 + opcode) {
      case 0x10: /* SQRDMLAH (vector) */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_three_reg_same_extra(DisasContext *s,
              unallocated_encoding(s);
              return;
          }
 -        feature = ARM_FEATURE_V8_RDM;
 +        feature = dc_isar_feature(aa64_rdm, s);
          break;
      default:
          unallocated_encoding(s);
          return;
      }
 -    if (!arm_dc_feature(s, feature)) {
 +    if (!feature) {
          unallocated_encoding(s);
          return;
      }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_diff(DisasContext *s, uint32_t insn)
              return;
          }
          if (size == 3) {
 -            if (!arm_dc_feature(s, ARM_FEATURE_V8_PMULL)) {
 +            if (!dc_isar_feature(aa64_pmull, s)) {
                  unallocated_encoding(s);
                  return;
              }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
      int size = extract32(insn, 22, 2);
      bool u = extract32(insn, 29, 1);
      bool is_q = extract32(insn, 30, 1);
 -    int feature, rot;
 +    bool feature;
 +    int rot;
      switch (u * 16 + opcode) {
      case 0x10: /* SQRDMLAH (vector) */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
              unallocated_encoding(s);
              return;
          }
 -        feature = ARM_FEATURE_V8_RDM;
 +        feature = dc_isar_feature(aa64_rdm, s);
          break;
      case 0x02: /* SDOT (vector) */
      case 0x12: /* UDOT (vector) */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
              unallocated_encoding(s);
              return;
          }
 -        feature = ARM_FEATURE_V8_DOTPROD;
 +        feature = dc_isar_feature(aa64_dp, s);
          break;
      case 0x18: /* FCMLA, #0 */
      case 0x19: /* FCMLA, #90 */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
              unallocated_encoding(s);
              return;
          }
 -        feature = ARM_FEATURE_V8_FCMA;
 +        feature = dc_isar_feature(aa64_fcma, s);
          break;
      default:
          unallocated_encoding(s);
          return;
      }
 -    if (!arm_dc_feature(s, feature)) {
 +    if (!feature) {
          unallocated_encoding(s);
          return;
      }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
          break;
      case 0x1d: /* SQRDMLAH */
      case 0x1f: /* SQRDMLSH */
 -        if (!arm_dc_feature(s, ARM_FEATURE_V8_RDM)) {
 +        if (!dc_isar_feature(aa64_rdm, s)) {
              unallocated_encoding(s);
              return;
          }
          break;
      case 0x0e: /* SDOT */
      case 0x1e: /* UDOT */
 -        if (size != MO_32 || !arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
 +        if (size != MO_32 || !dc_isar_feature(aa64_dp, s)) {
              unallocated_encoding(s);
              return;
          }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
      case 0x13: /* FCMLA #90 */
      case 0x15: /* FCMLA #180 */
      case 0x17: /* FCMLA #270 */
 -        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)) {
 +        if (!dc_isar_feature(aa64_fcma, s)) {
              unallocated_encoding(s);
              return;
          }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_aes(DisasContext *s, uint32_t insn)
      TCGv_i32 tcg_decrypt;
      CryptoThreeOpIntFn *genfn;
 -    if (!arm_dc_feature(s, ARM_FEATURE_V8_AES)
 -        || size != 0) {
 +    if (!dc_isar_feature(aa64_aes, s) || size != 0) {
          unallocated_encoding(s);
          return;
      }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_sha(DisasContext *s, uint32_t insn)
      int rd = extract32(insn, 0, 5);
      CryptoThreeOpFn *genfn;
      TCGv_ptr tcg_rd_ptr, tcg_rn_ptr, tcg_rm_ptr;
 -    int feature = ARM_FEATURE_V8_SHA256;
 +    bool feature;
      if (size != 0) {
          unallocated_encoding(s);
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_sha(DisasContext *s, uint32_t insn)
      case 2: /* SHA1M */
      case 3: /* SHA1SU0 */
          genfn = NULL;
 -        feature = ARM_FEATURE_V8_SHA1;
 +        feature = dc_isar_feature(aa64_sha1, s);
          break;
      case 4: /* SHA256H */
          genfn = gen_helper_crypto_sha256h;
 +        feature = dc_isar_feature(aa64_sha256, s);
          break;
      case 5: /* SHA256H2 */
          genfn = gen_helper_crypto_sha256h2;
 +        feature = dc_isar_feature(aa64_sha256, s);
          break;
      case 6: /* SHA256SU1 */
          genfn = gen_helper_crypto_sha256su1;
 +        feature = dc_isar_feature(aa64_sha256, s);
          break;
      default:
          unallocated_encoding(s);
          return;
      }
 -    if (!arm_dc_feature(s, feature)) {
 +    if (!feature) {
          unallocated_encoding(s);
          return;
      }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha(DisasContext *s, uint32_t insn)
      int rn = extract32(insn, 5, 5);
      int rd = extract32(insn, 0, 5);
      CryptoTwoOpFn *genfn;
 -    int feature;
 +    bool feature;
      TCGv_ptr tcg_rd_ptr, tcg_rn_ptr;
      if (size != 0) {
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha(DisasContext *s, uint32_t insn)
      switch (opcode) {
      case 0: /* SHA1H */
 -        feature = ARM_FEATURE_V8_SHA1;
 +        feature = dc_isar_feature(aa64_sha1, s);
          genfn = gen_helper_crypto_sha1h;
          break;
      case 1: /* SHA1SU1 */
 -        feature = ARM_FEATURE_V8_SHA1;
 +        feature = dc_isar_feature(aa64_sha1, s);
          genfn = gen_helper_crypto_sha1su1;
          break;
      case 2: /* SHA256SU0 */
 -        feature = ARM_FEATURE_V8_SHA256;
 +        feature = dc_isar_feature(aa64_sha256, s);
          genfn = gen_helper_crypto_sha256su0;
          break;
      default:
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha(DisasContext *s, uint32_t insn)
          return;
      }
 -    if (!arm_dc_feature(s, feature)) {
 +    if (!feature) {
          unallocated_encoding(s);
          return;
      }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_sha512(DisasContext *s, uint32_t insn)
      int rm = extract32(insn, 16, 5);
      int rn = extract32(insn, 5, 5);
      int rd = extract32(insn, 0, 5);
 -    int feature;
 +    bool feature;
      CryptoThreeOpFn *genfn;
      if (o == 0) {
          switch (opcode) {
          case 0: /* SHA512H */
 -            feature = ARM_FEATURE_V8_SHA512;
 +            feature = dc_isar_feature(aa64_sha512, s);
              genfn = gen_helper_crypto_sha512h;
              break;
          case 1: /* SHA512H2 */
 -            feature = ARM_FEATURE_V8_SHA512;
 +            feature = dc_isar_feature(aa64_sha512, s);
              genfn = gen_helper_crypto_sha512h2;
              break;
          case 2: /* SHA512SU1 */
 -            feature = ARM_FEATURE_V8_SHA512;
 +            feature = dc_isar_feature(aa64_sha512, s);
              genfn = gen_helper_crypto_sha512su1;
              break;
          case 3: /* RAX1 */
 -            feature = ARM_FEATURE_V8_SHA3;
 +            feature = dc_isar_feature(aa64_sha3, s);
              genfn = NULL;
              break;
          }
      } else {
          switch (opcode) {
          case 0: /* SM3PARTW1 */
 -            feature = ARM_FEATURE_V8_SM3;
 +            feature = dc_isar_feature(aa64_sm3, s);
              genfn = gen_helper_crypto_sm3partw1;
              break;
          case 1: /* SM3PARTW2 */
 -            feature = ARM_FEATURE_V8_SM3;
 +            feature = dc_isar_feature(aa64_sm3, s);
              genfn = gen_helper_crypto_sm3partw2;
              break;
          case 2: /* SM4EKEY */
 -            feature = ARM_FEATURE_V8_SM4;
 +            feature = dc_isar_feature(aa64_sm4, s);
              genfn = gen_helper_crypto_sm4ekey;
              break;
          default:
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_sha512(DisasContext *s, uint32_t insn)
          }
      }
--    if (!arm_dc_feature(s, feature)) {
+-    tcg_temp_free_i32(tcg_shift);
-+    if (!feature) {
+     gen_helper_set_rmode(tcg_rmode, tcg_rmode, tcg_fpstatus);
-         unallocated_encoding(s);
+     tcg_temp_free_ptr(tcg_fpstatus);
-         return;
+     tcg_temp_free_i32(tcg_rmode);
-     }
+@@ -XXX,XX +XXX,XX @@ static void handle_2misc_64(DisasContext *s, int opcode, bool u,
-@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha512(DisasContext *s, uint32_t insn)
+     case 0x1c: /* FCVTAS */
-     int rn = extract32(insn, 5, 5);
+     case 0x3a: /* FCVTPS */
-     int rd = extract32(insn, 0, 5);
+     case 0x3b: /* FCVTZS */
-     TCGv_ptr tcg_rd_ptr, tcg_rn_ptr;
+-    {
--    int feature;
+-        TCGv_i32 tcg_shift = tcg_const_i32(0);
-+    bool feature;
+-        gen_helper_vfp_tosqd(tcg_rd, tcg_rn, tcg_shift, tcg_fpstatus);
-     CryptoTwoOpFn *genfn;
+-        tcg_temp_free_i32(tcg_shift);
++        gen_helper_vfp_tosqd(tcg_rd, tcg_rn, tcg_constant_i32(0), tcg_fpstatus);
      switch (opcode) {
      case 0: /* SHA512SU0 */
 -        feature = ARM_FEATURE_V8_SHA512;
 +        feature = dc_isar_feature(aa64_sha512, s);
          genfn = gen_helper_crypto_sha512su0;
          break;
-     case 1: /* SM4E */
+-    }
--        feature = ARM_FEATURE_V8_SM4;
+     case 0x5a: /* FCVTNU */
-+        feature = dc_isar_feature(aa64_sm4, s);
+     case 0x5b: /* FCVTMU */
-         genfn = gen_helper_crypto_sm4e;
+     case 0x5c: /* FCVTAU */
      case 0x7a: /* FCVTPU */
      case 0x7b: /* FCVTZU */
 -    {
 -        TCGv_i32 tcg_shift = tcg_const_i32(0);
 -        gen_helper_vfp_touqd(tcg_rd, tcg_rn, tcg_shift, tcg_fpstatus);
 -        tcg_temp_free_i32(tcg_shift);
 +        gen_helper_vfp_touqd(tcg_rd, tcg_rn, tcg_constant_i32(0), tcg_fpstatus);
          break;
-     default:
+-    }
-@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha512(DisasContext *s, uint32_t insn)
+     case 0x18: /* FRINTN */
-         return;
+     case 0x19: /* FRINTM */
-     }
+     case 0x38: /* FRINTP */
+@@ -XXX,XX +XXX,XX @@ static void handle_2misc_fcmp_zero(DisasContext *s, int opcode,
--    if (!arm_dc_feature(s, feature)) {
-+    if (!feature) {
+     if (is_double) {
-         unallocated_encoding(s);
+         TCGv_i64 tcg_op = tcg_temp_new_i64();
-         return;
+-        TCGv_i64 tcg_zero = tcg_const_i64(0);
-     }
++        TCGv_i64 tcg_zero = tcg_constant_i64(0);
-@@ -XXX,XX +XXX,XX @@ static void disas_crypto_four_reg(DisasContext *s, uint32_t insn)
+         TCGv_i64 tcg_res = tcg_temp_new_i64();
-     int ra = extract32(insn, 10, 5);
+         NeonGenTwoDoubleOpFn *genfn;
-     int rn = extract32(insn, 5, 5);
+         bool swap = false;
-     int rd = extract32(insn, 0, 5);
+@@ -XXX,XX +XXX,XX @@ static void handle_2misc_fcmp_zero(DisasContext *s, int opcode,
--    int feature;
+             write_vec_element(s, tcg_res, rd, pass, MO_64);
-+    bool feature;
+         }
+         tcg_temp_free_i64(tcg_res);
-     switch (op0) {
+-        tcg_temp_free_i64(tcg_zero);
-     case 0: /* EOR3 */
+         tcg_temp_free_i64(tcg_op);
-     case 1: /* BCAX */
--        feature = ARM_FEATURE_V8_SHA3;
+         clear_vec_high(s, !is_scalar, rd);
-+        feature = dc_isar_feature(aa64_sha3, s);
+     } else {
-         break;
+         TCGv_i32 tcg_op = tcg_temp_new_i32();
-     case 2: /* SM3SS1 */
+-        TCGv_i32 tcg_zero = tcg_const_i32(0);
--        feature = ARM_FEATURE_V8_SM3;
++        TCGv_i32 tcg_zero = tcg_constant_i32(0);
-+        feature = dc_isar_feature(aa64_sm3, s);
+         TCGv_i32 tcg_res = tcg_temp_new_i32();
-         break;
+         NeonGenTwoSingleOpFn *genfn;
-     default:
+         bool swap = false;
-         unallocated_encoding(s);
+@@ -XXX,XX +XXX,XX @@ static void handle_2misc_fcmp_zero(DisasContext *s, int opcode,
          return;
      }
 -    if (!arm_dc_feature(s, feature)) {
 +    if (!feature) {
          unallocated_encoding(s);
          return;
      }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_xar(DisasContext *s, uint32_t insn)
      TCGv_i64 tcg_op1, tcg_op2, tcg_res[2];
      int pass;
 -    if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA3)) {
 +    if (!dc_isar_feature(aa64_sha3, s)) {
          unallocated_encoding(s);
          return;
      }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_imm2(DisasContext *s, uint32_t insn)
      TCGv_ptr tcg_rd_ptr, tcg_rn_ptr, tcg_rm_ptr;
      TCGv_i32 tcg_imm2, tcg_opcode;
 -    if (!arm_dc_feature(s, ARM_FEATURE_V8_SM3)) {
 +    if (!dc_isar_feature(aa64_sm3, s)) {
          unallocated_encoding(s);
          return;
      }
@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_init_disas_context(DisasContextBase *dcbase,
      ARMCPU *arm_cpu = arm_env_get_cpu(env);
      int bound;
 +    dc->isar = &arm_cpu->isar;
      dc->pc = dc->base.pc_first;
      dc->condjmp = 0;
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static const uint8_t neon_2rm_sizes[] = {
  static int do_v81_helper(DisasContext *s, gen_helper_gvec_3_ptr *fn,
                           int q, int rd, int rn, int rm)
  {
 -    if (arm_dc_feature(s, ARM_FEATURE_V8_RDM)) {
 +    if (dc_isar_feature(aa32_rdm, s)) {
          int opr_sz = (1 + q) * 8;
          tcg_gen_gvec_3_ptr(vfp_reg_offset(1, rd),
                             vfp_reg_offset(1, rn),
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                  return 1;
              }
-             if (!u) { /* SHA-1 */
--                if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA1)) {
-+                if (!dc_isar_feature(aa32_sha1, s)) {
-                     return 1;
-                 }
-                 ptr1 = vfp_reg_ptr(true, rd);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                 gen_helper_crypto_sha1_3reg(ptr1, ptr2, ptr3, tmp4);
-                 tcg_temp_free_i32(tmp4);
-             } else { /* SHA-256 */
--                if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA256) || size == 3) {
-+                if (!dc_isar_feature(aa32_sha2, s) || size == 3) {
-                     return 1;
-                 }
-                 ptr1 = vfp_reg_ptr(true, rd);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                 if (op == 14 && size == 2) {
-                     TCGv_i64 tcg_rn, tcg_rm, tcg_rd;
--                    if (!arm_dc_feature(s, ARM_FEATURE_V8_PMULL)) {
-+                    if (!dc_isar_feature(aa32_pmull, s)) {
-                         return 1;
-                     }
-                     tcg_rn = tcg_temp_new_i64();
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                     {
-                         NeonGenThreeOpEnvFn *fn;
--                        if (!arm_dc_feature(s, ARM_FEATURE_V8_RDM)) {
-+                        if (!dc_isar_feature(aa32_rdm, s)) {
-                             return 1;
-                         }
-                         if (u && ((rd | rn) & 1)) {
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                     break;
-                 }
-                 case NEON_2RM_AESE: case NEON_2RM_AESMC:
--                    if (!arm_dc_feature(s, ARM_FEATURE_V8_AES)
--                        || ((rm | rd) & 1)) {
-+                    if (!dc_isar_feature(aa32_aes, s) || ((rm | rd) & 1)) {
-                         return 1;
-                     }
-                     ptr1 = vfp_reg_ptr(true, rd);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                     tcg_temp_free_i32(tmp3);
-                     break;
-                 case NEON_2RM_SHA1H:
--                    if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA1)
--                        || ((rm | rd) & 1)) {
-+                    if (!dc_isar_feature(aa32_sha1, s) || ((rm | rd) & 1)) {
-                         return 1;
-                     }
-                     ptr1 = vfp_reg_ptr(true, rd);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                     }
-                     /* bit 6 (q): set -> SHA256SU0, cleared -> SHA1SU1 */
-                     if (q) {
--                        if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA256)) {
-+                        if (!dc_isar_feature(aa32_sha2, s)) {
-                             return 1;
-                         }
--                    } else if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA1)) {
-+                    } else if (!dc_isar_feature(aa32_sha1, s)) {
-                         return 1;
-                     }
-                     ptr1 = vfp_reg_ptr(true, rd);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
-         /* VCMLA -- 1111 110R R.1S .... .... 1000 ...0 .... */
-         int size = extract32(insn, 20, 1);
-         data = extract32(insn, 23, 2); /* rot */
--        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)
-+        if (!dc_isar_feature(aa32_vcma, s)
-             || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
-             return 1;
          }
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
+         tcg_temp_free_i32(tcg_res);
-         /* VCADD -- 1111 110R 1.0S .... .... 1000 ...0 .... */
+-        tcg_temp_free_i32(tcg_zero);
-         int size = extract32(insn, 20, 1);
+         tcg_temp_free_i32(tcg_op);
-         data = extract32(insn, 24, 1); /* rot */
+         if (!is_scalar) {
--        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)
+             clear_vec_high(s, is_q, rd);
 +        if (!dc_isar_feature(aa32_vcma, s)
              || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
              return 1;
          }
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
      } else if ((insn & 0xfeb00f00) == 0xfc200d00) {
          /* V[US]DOT -- 1111 1100 0.10 .... .... 1101 .Q.U .... */
          bool u = extract32(insn, 4, 1);
 -        if (!arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
 +        if (!dc_isar_feature(aa32_dp, s)) {
              return 1;
          }
          fn_gvec = u ? gen_helper_gvec_udot_b : gen_helper_gvec_sdot_b;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
          int size = extract32(insn, 23, 1);
          int index;
 -        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)) {
 +        if (!dc_isar_feature(aa32_vcma, s)) {
              return 1;
          }
          if (size == 0) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
      } else if ((insn & 0xffb00f00) == 0xfe200d00) {
          /* V[US]DOT -- 1111 1110 0.10 .... .... 1101 .Q.U .... */
          int u = extract32(insn, 4, 1);
 -        if (!arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
 +        if (!dc_isar_feature(aa32_dp, s)) {
              return 1;
          }
          fn_gvec = u ? gen_helper_gvec_udot_idx_b : gen_helper_gvec_sdot_idx_b;
@@ -XXX,XX +XXX,XX @@ static void disas_arm_insn(DisasContext *s, unsigned int insn)
               * op1 == 3 is UNPREDICTABLE but handle as UNDEFINED.
               * Bits 8, 10 and 11 should be zero.
               */
 -            if (!arm_dc_feature(s, ARM_FEATURE_CRC) || op1 == 0x3 ||
 -                (c & 0xd) != 0) {
 +            if (!dc_isar_feature(aa32_crc32, s) || op1 == 0x3 || (c & 0xd) != 0) {
                  goto illegal_op;
              }
@@ -XXX,XX +XXX,XX @@ static void disas_thumb2_insn(DisasContext *s, uint32_t insn)
                  case 0x28:
                  case 0x29:
                  case 0x2a:
 -                    if (!arm_dc_feature(s, ARM_FEATURE_CRC)) {
 +                    if (!dc_isar_feature(aa32_crc32, s)) {
                          goto illegal_op;
                      }
                      break;
@@ -XXX,XX +XXX,XX @@ static void arm_tr_init_disas_context(DisasContextBase *dcbase, CPUState *cs)
      CPUARMState *env = cs->env_ptr;
      ARMCPU *cpu = arm_env_get_cpu(env);
 +    dc->isar = &cpu->isar;
      dc->pc = dc->base.pc_first;
      dc->condjmp = 0;
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 21/45] hw/arm/boot: Increase compliance with kernel arm64 boot protocol
+[PULL 20/54] target/arm: Use tcg_constant in 2misc expanders
-From: Stewart Hildebrand <Stewart.Hildebrand@dornerworks.com>
+From: Richard Henderson <richard.henderson@linaro.org>
-"The Image must be placed text_offset bytes from a 2MB aligned base
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 address anywhere in usable system RAM and called there."
 For the virt board, we write our startup bootloader at the very
 bottom of RAM, so that bit can't be used for the image. To avoid
 overlap in case the image requests to be loaded at an offset
 smaller than our bootloader, we increment the load offset to the
 next 2MB.
 This fixes a boot failure for Xen AArch64.
 Signed-off-by: Stewart Hildebrand <stewart.hildebrand@dornerworks.com>
 Tested-by: Andre Przywara <andre.przywara@arm.com>
 Message-id: b8a89518794b4436af0c151ed10de4fa@dornerworks.com
 [PMM: Rephrased a comment a bit]
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-21-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- hw/arm/boot.c | 18 ++++++++++++++++++
+ target/arm/translate-a64.c | 40 ++++++++++----------------------------
-file changed, 18 insertions(+)
+file changed, 10 insertions(+), 30 deletions(-)
-diff --git a/hw/arm/boot.c b/hw/arm/boot.c
+diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
---- a/hw/arm/boot.c
+--- a/target/arm/translate-a64.c
-+++ b/hw/arm/boot.c
++++ b/target/arm/translate-a64.c
-@@ -XXX,XX +XXX,XX @@
+@@ -XXX,XX +XXX,XX @@ static void handle_2misc_narrow(DisasContext *s, bool scalar,
- #include "qemu/config-file.h"
+     int passes = scalar ? 1 : 2;
- #include "qemu/option.h"
- #include "exec/address-spaces.h"
+     if (scalar) {
-+#include "qemu/units.h"
+-        tcg_res[1] = tcg_const_i32(0);
++        tcg_res[1] = tcg_constant_i32(0);
  /* Kernel boot protocol is specified in the kernel docs
   * Documentation/arm/Booting and Documentation/arm64/booting.txt
@@ -XXX,XX +XXX,XX @@
  #define ARM64_TEXT_OFFSET_OFFSET    8
  #define ARM64_MAGIC_OFFSET          56
 +#define BOOTLOADER_MAX_SIZE         (4 * KiB)
 +
  AddressSpace *arm_boot_address_space(ARMCPU *cpu,
                                       const struct arm_boot_info *info)
  {
@@ -XXX,XX +XXX,XX @@ static void write_bootloader(const char *name, hwaddr addr,
          code[i] = tswap32(insn);
      }
-+    assert((len * sizeof(uint32_t)) < BOOTLOADER_MAX_SIZE);
+     for (pass = 0; pass < passes; pass++) {
-+
+@@ -XXX,XX +XXX,XX @@ static void handle_2misc_satacc(DisasContext *s, bool is_scalar, bool is_u,
-     rom_add_blob_fixed_as(name, code, len * sizeof(uint32_t), addr, as);
+             }
-     g_free(code);
+             if (is_scalar) {
-@@ -XXX,XX +XXX,XX @@ static uint64_t load_aarch64_image(const char *filename, hwaddr mem_base,
+-                TCGv_i64 tcg_zero = tcg_const_i64(0);
-         memcpy(&hdrvals, buffer + ARM64_TEXT_OFFSET_OFFSET, sizeof(hdrvals));
+-                write_vec_element(s, tcg_zero, rd, 0, MO_64);
-         if (hdrvals[1] != 0) {
+-                tcg_temp_free_i64(tcg_zero);
-             kernel_load_offset = le64_to_cpu(hdrvals[0]);
++                write_vec_element(s, tcg_constant_i64(0), rd, 0, MO_64);
-+
+             }
-+            /*
+             write_vec_element_i32(s, tcg_rd, rd, pass, MO_32);
-+             * We write our startup "bootloader" at the very bottom of RAM,
+         }
-+             * so that bit can't be used for the image. Luckily the Image
+@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_two_reg_misc(DisasContext *s, uint32_t insn)
-+             * format specification is that the image requests only an offset
+         case 0x1c: /* FCVTAS */
-+             * from a 2MB boundary, not an absolute load address. So if the
+         case 0x3a: /* FCVTPS */
-+             * image requests an offset that might mean it overlaps with the
+         case 0x3b: /* FCVTZS */
-+             * bootloader, we can just load it starting at 2MB+offset rather
+-        {
-+             * than 0MB + offset.
+-            TCGv_i32 tcg_shift = tcg_const_i32(0);
-+             */
+-            gen_helper_vfp_tosls(tcg_rd, tcg_rn, tcg_shift, tcg_fpstatus);
-+            if (kernel_load_offset < BOOTLOADER_MAX_SIZE) {
+-            tcg_temp_free_i32(tcg_shift);
-+                kernel_load_offset += 2 * MiB;
++            gen_helper_vfp_tosls(tcg_rd, tcg_rn, tcg_constant_i32(0),
-+            }
++                                 tcg_fpstatus);
              break;
 -        }
          case 0x5a: /* FCVTNU */
          case 0x5b: /* FCVTMU */
          case 0x5c: /* FCVTAU */
          case 0x7a: /* FCVTPU */
          case 0x7b: /* FCVTZU */
 -        {
 -            TCGv_i32 tcg_shift = tcg_const_i32(0);
 -            gen_helper_vfp_touls(tcg_rd, tcg_rn, tcg_shift, tcg_fpstatus);
 -            tcg_temp_free_i32(tcg_shift);
 +            gen_helper_vfp_touls(tcg_rd, tcg_rn, tcg_constant_i32(0),
 +                                 tcg_fpstatus);
              break;
 -        }
          default:
              g_assert_not_reached();
          }
@@ -XXX,XX +XXX,XX @@ static void handle_vec_simd_shrn(DisasContext *s, bool is_q,
      read_vec_element(s, tcg_final, rd, is_q ? 1 : 0, MO_64);
      if (round) {
 -        uint64_t round_const = 1ULL << (shift - 1);
 -        tcg_round = tcg_const_i64(round_const);
 +        tcg_round = tcg_constant_i64(1ULL << (shift - 1));
      } else {
          tcg_round = NULL;
      }
@@ -XXX,XX +XXX,XX @@ static void handle_vec_simd_shrn(DisasContext *s, bool is_q,
      } else {
          write_vec_element(s, tcg_final, rd, 1, MO_64);
      }
 -    if (round) {
 -        tcg_temp_free_i64(tcg_round);
 -    }
      tcg_temp_free_i64(tcg_rn);
      tcg_temp_free_i64(tcg_rd);
      tcg_temp_free_i64(tcg_final);
@@ -XXX,XX +XXX,XX @@ static void handle_2misc_pairwise(DisasContext *s, int opcode, bool u,
          }
      }
+     if (!is_q) {
 -        tcg_res[1] = tcg_const_i64(0);
 +        tcg_res[1] = tcg_constant_i64(0);
      }
      for (pass = 0; pass < 2; pass++) {
          write_vec_element(s, tcg_res[pass], rd, pass, MO_64);
@@ -XXX,XX +XXX,XX @@ static void disas_simd_two_reg_misc(DisasContext *s, uint32_t insn)
                  case 0x1c: /* FCVTAS */
                  case 0x3a: /* FCVTPS */
                  case 0x3b: /* FCVTZS */
 -                {
 -                    TCGv_i32 tcg_shift = tcg_const_i32(0);
                      gen_helper_vfp_tosls(tcg_res, tcg_op,
 -                                         tcg_shift, tcg_fpstatus);
 -                    tcg_temp_free_i32(tcg_shift);
 +                                         tcg_constant_i32(0), tcg_fpstatus);
                      break;
 -                }
                  case 0x5a: /* FCVTNU */
                  case 0x5b: /* FCVTMU */
                  case 0x5c: /* FCVTAU */
                  case 0x7a: /* FCVTPU */
                  case 0x7b: /* FCVTZU */
 -                {
 -                    TCGv_i32 tcg_shift = tcg_const_i32(0);
                      gen_helper_vfp_touls(tcg_res, tcg_op,
 -                                         tcg_shift, tcg_fpstatus);
 -                    tcg_temp_free_i32(tcg_shift);
 +                                         tcg_constant_i32(0), tcg_fpstatus);
                      break;
 -                }
                  case 0x18: /* FRINTN */
                  case 0x19: /* FRINTM */
                  case 0x38: /* FRINTP */
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 29/45] target/arm: Use gvec for NEON_3R_LOGIC insns
+[PULL 21/54] target/arm: Use tcg_constant in balance of translate-a64.c
 From: Richard Henderson <richard.henderson@linaro.org>
-Move expanders for VBSL, VBIT, and VBIF from translate-a64.c.
+Finish conversion of the file to tcg_constant_*.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-9-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-22-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.h     |   6 ++
+ target/arm/translate-a64.c | 20 ++++++++------------
- target/arm/translate-a64.c |  61 --------------
+file changed, 8 insertions(+), 12 deletions(-)
  target/arm/translate.c     | 162 +++++++++++++++++++++++++++----------
 files changed, 124 insertions(+), 105 deletions(-)
-diff --git a/target/arm/translate.h b/target/arm/translate.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.h
-+++ b/target/arm/translate.h
-@@ -XXX,XX +XXX,XX @@ static inline TCGv_i32 get_ahp_flag(void)
-     return ret;
- }
-+
-+/* Vector operations shared between ARM and AArch64.  */
-+extern const GVecGen3 bsl_op;
-+extern const GVecGen3 bit_op;
-+extern const GVecGen3 bif_op;
-+
- /*
-  * Forward to the isar_feature_* tests given a DisasContext pointer.
-  */
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_diff(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
          }
          if (is_scalar) {
 -            tcg_res[1] = tcg_const_i64(0);
 +            tcg_res[1] = tcg_constant_i64(0);
          }
          for (pass = 0; pass < 2; pass++) {
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_four_reg(DisasContext *s, uint32_t insn)
          tcg_op2 = tcg_temp_new_i32();
          tcg_op3 = tcg_temp_new_i32();
          tcg_res = tcg_temp_new_i32();
 -        tcg_zero = tcg_const_i32(0);
 +        tcg_zero = tcg_constant_i32(0);
          read_vec_element_i32(s, tcg_op1, rn, 3, MO_32);
          read_vec_element_i32(s, tcg_op2, rm, 3, MO_32);
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_four_reg(DisasContext *s, uint32_t insn)
          tcg_temp_free_i32(tcg_op2);
          tcg_temp_free_i32(tcg_op3);
          tcg_temp_free_i32(tcg_res);
 -        tcg_temp_free_i32(tcg_zero);
      }
  }
--static void gen_bsl_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
+@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_tb_stop(DisasContextBase *dcbase, CPUState *cpu)
--{
+             gen_helper_yield(cpu_env);
--    tcg_gen_xor_i64(rn, rn, rm);
+             break;
--    tcg_gen_and_i64(rn, rn, rd);
+         case DISAS_WFI:
--    tcg_gen_xor_i64(rd, rm, rn);
+-        {
--}
+-            /* This is a special case because we don't want to just halt the CPU
 -             * if trying to debug across a WFI.
 +            /*
 +             * This is a special case because we don't want to just halt
 +             * the CPU if trying to debug across a WFI.
               */
 -            TCGv_i32 tmp = tcg_const_i32(4);
 -
--static void gen_bit_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
+             gen_a64_set_pc_im(dc->base.pc_next);
--{
+-            gen_helper_wfi(cpu_env, tmp);
--    tcg_gen_xor_i64(rn, rn, rd);
+-            tcg_temp_free_i32(tmp);
--    tcg_gen_and_i64(rn, rn, rm);
+-            /* The helper doesn't necessarily throw an exception, but we
--    tcg_gen_xor_i64(rd, rd, rn);
++            gen_helper_wfi(cpu_env, tcg_constant_i32(4));
--}
++            /*
--
++             * The helper doesn't necessarily throw an exception, but we
--static void gen_bif_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
+              * must go back to the main loop to check for interrupts anyway.
--{
+              */
--    tcg_gen_xor_i64(rn, rn, rd);
+             tcg_gen_exit_tb(NULL, 0);
--    tcg_gen_andc_i64(rn, rn, rm);
+             break;
--    tcg_gen_xor_i64(rd, rd, rn);
+         }
--}
+-        }
--
+     }
 -static void gen_bsl_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
 -{
 -    tcg_gen_xor_vec(vece, rn, rn, rm);
 -    tcg_gen_and_vec(vece, rn, rn, rd);
 -    tcg_gen_xor_vec(vece, rd, rm, rn);
 -}
 -
 -static void gen_bit_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
 -{
 -    tcg_gen_xor_vec(vece, rn, rn, rd);
 -    tcg_gen_and_vec(vece, rn, rn, rm);
 -    tcg_gen_xor_vec(vece, rd, rd, rn);
 -}
 -
 -static void gen_bif_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
 -{
 -    tcg_gen_xor_vec(vece, rn, rn, rd);
 -    tcg_gen_andc_vec(vece, rn, rn, rm);
 -    tcg_gen_xor_vec(vece, rd, rd, rn);
 -}
 -
  /* Logic op (opcode == 3) subgroup of C3.6.16. */
  static void disas_simd_3same_logic(DisasContext *s, uint32_t insn)
  {
 -    static const GVecGen3 bsl_op = {
 -        .fni8 = gen_bsl_i64,
 -        .fniv = gen_bsl_vec,
 -        .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -        .load_dest = true
 -    };
 -    static const GVecGen3 bit_op = {
 -        .fni8 = gen_bit_i64,
 -        .fniv = gen_bit_vec,
 -        .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -        .load_dest = true
 -    };
 -    static const GVecGen3 bif_op = {
 -        .fni8 = gen_bif_i64,
 -        .fniv = gen_bif_vec,
 -        .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -        .load_dest = true
 -    };
 -
      int rd = extract32(insn, 0, 5);
      int rn = extract32(insn, 5, 5);
      int rm = extract32(insn, 16, 5);
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
      return 0;
  }
--/* Bitwise select.  dest = c ? t : f.  Clobbers T and F.  */
--static void gen_neon_bsl(TCGv_i32 dest, TCGv_i32 t, TCGv_i32 f, TCGv_i32 c)
--{
--    tcg_gen_and_i32(t, t, c);
--    tcg_gen_andc_i32(f, f, c);
--    tcg_gen_or_i32(dest, t, f);
--}
--
- static inline void gen_neon_narrow(int size, TCGv_i32 dest, TCGv_i64 src)
- {
-     switch (size) {
-@@ -XXX,XX +XXX,XX @@ static int do_v81_helper(DisasContext *s, gen_helper_gvec_3_ptr *fn,
-     return 1;
- }
-+/*
-+ * Expanders for VBitOps_VBIF, VBIT, VBSL.
-+ */
-+static void gen_bsl_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
-+{
-+    tcg_gen_xor_i64(rn, rn, rm);
-+    tcg_gen_and_i64(rn, rn, rd);
-+    tcg_gen_xor_i64(rd, rm, rn);
-+}
-+
-+static void gen_bit_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
-+{
-+    tcg_gen_xor_i64(rn, rn, rd);
-+    tcg_gen_and_i64(rn, rn, rm);
-+    tcg_gen_xor_i64(rd, rd, rn);
-+}
-+
-+static void gen_bif_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
-+{
-+    tcg_gen_xor_i64(rn, rn, rd);
-+    tcg_gen_andc_i64(rn, rn, rm);
-+    tcg_gen_xor_i64(rd, rd, rn);
-+}
-+
-+static void gen_bsl_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
-+{
-+    tcg_gen_xor_vec(vece, rn, rn, rm);
-+    tcg_gen_and_vec(vece, rn, rn, rd);
-+    tcg_gen_xor_vec(vece, rd, rm, rn);
-+}
-+
-+static void gen_bit_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
-+{
-+    tcg_gen_xor_vec(vece, rn, rn, rd);
-+    tcg_gen_and_vec(vece, rn, rn, rm);
-+    tcg_gen_xor_vec(vece, rd, rd, rn);
-+}
-+
-+static void gen_bif_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
-+{
-+    tcg_gen_xor_vec(vece, rn, rn, rd);
-+    tcg_gen_andc_vec(vece, rn, rn, rm);
-+    tcg_gen_xor_vec(vece, rd, rd, rn);
-+}
-+
-+const GVecGen3 bsl_op = {
-+    .fni8 = gen_bsl_i64,
-+    .fniv = gen_bsl_vec,
-+    .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-+    .load_dest = true
-+};
-+
-+const GVecGen3 bit_op = {
-+    .fni8 = gen_bit_i64,
-+    .fniv = gen_bit_vec,
-+    .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-+    .load_dest = true
-+};
-+
-+const GVecGen3 bif_op = {
-+    .fni8 = gen_bif_i64,
-+    .fniv = gen_bif_vec,
-+    .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-+    .load_dest = true
-+};
-+
-+
- /* Translate a NEON data processing instruction.  Return nonzero if the
-    instruction is invalid.
-    We process data in a mixture of 32-bit and 64-bit chunks.
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
- {
-     int op;
-     int q;
--    int rd, rn, rm;
-+    int rd, rn, rm, rd_ofs, rn_ofs, rm_ofs;
-     int size;
-     int shift;
-     int pass;
-     int count;
-     int pairwise;
-     int u;
-+    int vec_size;
-     uint32_t imm, mask;
-     TCGv_i32 tmp, tmp2, tmp3, tmp4, tmp5;
-     TCGv_ptr ptr1, ptr2, ptr3;
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-     VFP_DREG_N(rn, insn);
-     VFP_DREG_M(rm, insn);
-     size = (insn >> 20) & 3;
-+    vec_size = q ? 16 : 8;
-+    rd_ofs = neon_reg_offset(rd, 0);
-+    rn_ofs = neon_reg_offset(rn, 0);
-+    rm_ofs = neon_reg_offset(rm, 0);
-+
-     if ((insn & (1 << 23)) == 0) {
-         /* Three register same length.  */
-         op = ((insn >> 7) & 0x1e) | ((insn >> 4) & 1);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                                      q, rd, rn, rm);
-             }
-             return 1;
-+
-+        case NEON_3R_LOGIC: /* Logic ops.  */
-+            switch ((u << 2) | size) {
-+            case 0: /* VAND */
-+                tcg_gen_gvec_and(0, rd_ofs, rn_ofs, rm_ofs,
-+                                 vec_size, vec_size);
-+                break;
-+            case 1: /* VBIC */
-+                tcg_gen_gvec_andc(0, rd_ofs, rn_ofs, rm_ofs,
-+                                  vec_size, vec_size);
-+                break;
-+            case 2:
-+                if (rn == rm) {
-+                    /* VMOV */
-+                    tcg_gen_gvec_mov(0, rd_ofs, rn_ofs, vec_size, vec_size);
-+                } else {
-+                    /* VORR */
-+                    tcg_gen_gvec_or(0, rd_ofs, rn_ofs, rm_ofs,
-+                                    vec_size, vec_size);
-+                }
-+                break;
-+            case 3: /* VORN */
-+                tcg_gen_gvec_orc(0, rd_ofs, rn_ofs, rm_ofs,
-+                                 vec_size, vec_size);
-+                break;
-+            case 4: /* VEOR */
-+                tcg_gen_gvec_xor(0, rd_ofs, rn_ofs, rm_ofs,
-+                                 vec_size, vec_size);
-+                break;
-+            case 5: /* VBSL */
-+                tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs,
-+                               vec_size, vec_size, &bsl_op);
-+                break;
-+            case 6: /* VBIT */
-+                tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs,
-+                               vec_size, vec_size, &bit_op);
-+                break;
-+            case 7: /* VBIF */
-+                tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs,
-+                               vec_size, vec_size, &bif_op);
-+                break;
-+            }
-+            return 0;
-         }
--        if (size == 3 && op != NEON_3R_LOGIC) {
-+        if (size == 3) {
-             /* 64-bit element instructions. */
-             for (pass = 0; pass < (q ? 2 : 1); pass++) {
-                 neon_load_reg64(cpu_V0, rn + pass);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-         case NEON_3R_VRHADD:
-             GEN_NEON_INTEGER_OP(rhadd);
-             break;
--        case NEON_3R_LOGIC: /* Logic ops.  */
--            switch ((u << 2) | size) {
--            case 0: /* VAND */
--                tcg_gen_and_i32(tmp, tmp, tmp2);
--                break;
--            case 1: /* BIC */
--                tcg_gen_andc_i32(tmp, tmp, tmp2);
--                break;
--            case 2: /* VORR */
--                tcg_gen_or_i32(tmp, tmp, tmp2);
--                break;
--            case 3: /* VORN */
--                tcg_gen_orc_i32(tmp, tmp, tmp2);
--                break;
--            case 4: /* VEOR */
--                tcg_gen_xor_i32(tmp, tmp, tmp2);
--                break;
--            case 5: /* VBSL */
--                tmp3 = neon_load_reg(rd, pass);
--                gen_neon_bsl(tmp, tmp, tmp2, tmp3);
--                tcg_temp_free_i32(tmp3);
--                break;
--            case 6: /* VBIT */
--                tmp3 = neon_load_reg(rd, pass);
--                gen_neon_bsl(tmp, tmp, tmp3, tmp2);
--                tcg_temp_free_i32(tmp3);
--                break;
--            case 7: /* VBIF */
--                tmp3 = neon_load_reg(rd, pass);
--                gen_neon_bsl(tmp, tmp3, tmp, tmp2);
--                tcg_temp_free_i32(tmp3);
--                break;
--            }
--            break;
-         case NEON_3R_VHSUB:
-             GEN_NEON_INTEGER_OP(hsub);
-             break;
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 39/45] target/arm: Reorg NEON VLD/VST all elements
+[PULL 22/54] target/arm: Use tcg_constant for aa32 exceptions
 From: Richard Henderson <richard.henderson@linaro.org>
-Instead of shifts and masks, use direct loads and stores from the neon
-register file.  Mirror the iteration structure of the ARM pseudocode
-more closely.  Correct the parameters of the VLD2 A2 insn.
-Note that this includes a bugfix for handling of the insn
-"VLD2 (multiple 2-element structures)" -- we were using an
-incorrect stride value.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-19-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-23-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 170 ++++++++++++++++++-----------------------
+ target/arm/translate.c | 32 +++++++-------------------------
-file changed, 74 insertions(+), 96 deletions(-)
+file changed, 7 insertions(+), 25 deletions(-)
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static TCGv_i32 neon_load_reg(int reg, int pass)
+@@ -XXX,XX +XXX,XX @@ static void store_sp_checked(DisasContext *s, TCGv_i32 var)
-     return tmp;
  void gen_set_cpsr(TCGv_i32 var, uint32_t mask)
  {
 -    TCGv_i32 tmp_mask = tcg_const_i32(mask);
 -    gen_helper_cpsr_write(cpu_env, var, tmp_mask);
 -    tcg_temp_free_i32(tmp_mask);
 +    gen_helper_cpsr_write(cpu_env, var, tcg_constant_i32(mask));
  }
-+static void neon_load_element64(TCGv_i64 var, int reg, int ele, TCGMemOp mop)
+ static void gen_rebuild_hflags(DisasContext *s, bool new_el)
-+{
+@@ -XXX,XX +XXX,XX @@ static void gen_rebuild_hflags(DisasContext *s, bool new_el)
-+    long offset = neon_element_offset(reg, ele, mop & MO_SIZE);
-+
+ static void gen_exception_internal(int excp)
 +    switch (mop) {
 +    case MO_UB:
 +        tcg_gen_ld8u_i64(var, cpu_env, offset);
 +        break;
 +    case MO_UW:
 +        tcg_gen_ld16u_i64(var, cpu_env, offset);
 +        break;
 +    case MO_UL:
 +        tcg_gen_ld32u_i64(var, cpu_env, offset);
 +        break;
 +    case MO_Q:
 +        tcg_gen_ld_i64(var, cpu_env, offset);
 +        break;
 +    default:
 +        g_assert_not_reached();
 +    }
 +}
 +
  static void neon_store_reg(int reg, int pass, TCGv_i32 var)
  {
-     tcg_gen_st_i32(var, cpu_env, neon_reg_offset(reg, pass));
+-    TCGv_i32 tcg_excp = tcg_const_i32(excp);
-     tcg_temp_free_i32(var);
+-
      assert(excp_is_internal(excp));
 -    gen_helper_exception_internal(cpu_env, tcg_excp);
 -    tcg_temp_free_i32(tcg_excp);
 +    gen_helper_exception_internal(cpu_env, tcg_constant_i32(excp));
  }
-+static void neon_store_element64(int reg, int ele, TCGMemOp size, TCGv_i64 var)
+ static void gen_singlestep_exception(DisasContext *s)
-+{
+@@ -XXX,XX +XXX,XX @@ static inline void gen_smc(DisasContext *s)
-+    long offset = neon_element_offset(reg, ele, size);
+     /* As with HVC, we may take an exception either before or after
-+
+      * the insn executes.
-+    switch (size) {
+      */
-+    case MO_8:
+-    TCGv_i32 tmp;
-+        tcg_gen_st8_i64(var, cpu_env, offset);
+-
-+        break;
+     gen_set_pc_im(s, s->pc_curr);
-+    case MO_16:
+-    tmp = tcg_const_i32(syn_aa32_smc());
-+        tcg_gen_st16_i64(var, cpu_env, offset);
+-    gen_helper_pre_smc(cpu_env, tmp);
-+        break;
+-    tcg_temp_free_i32(tmp);
-+    case MO_32:
++    gen_helper_pre_smc(cpu_env, tcg_constant_i32(syn_aa32_smc()));
-+        tcg_gen_st32_i64(var, cpu_env, offset);
+     gen_set_pc_im(s, s->base.pc_next);
-+        break;
+     s->base.is_jmp = DISAS_SMC;
-+    case MO_64:
+ }
-+        tcg_gen_st_i64(var, cpu_env, offset);
+@@ -XXX,XX +XXX,XX @@ void gen_exception_insn(DisasContext *s, uint64_t pc, int excp,
-+        break;
-+    default:
+ static void gen_exception_bkpt_insn(DisasContext *s, uint32_t syn)
 +        g_assert_not_reached();
 +    }
 +}
 +
  static inline void neon_load_reg64(TCGv_i64 var, int reg)
  {
-     tcg_gen_ld_i64(var, cpu_env, vfp_reg_offset(1, reg));
+-    TCGv_i32 tcg_syn;
-@@ -XXX,XX +XXX,XX @@ static struct {
+-
-     int interleave;
+     gen_set_condexec(s);
-     int spacing;
+     gen_set_pc_im(s, s->pc_curr);
- } const neon_ls_element_type[11] = {
+-    tcg_syn = tcg_const_i32(syn);
--    {4, 4, 1},
+-    gen_helper_exception_bkpt_insn(cpu_env, tcg_syn);
--    {4, 4, 2},
+-    tcg_temp_free_i32(tcg_syn);
-+    {1, 4, 1},
++    gen_helper_exception_bkpt_insn(cpu_env, tcg_constant_i32(syn));
-+    {1, 4, 2},
+     s->base.is_jmp = DISAS_NORETURN;
-     {4, 1, 1},
+ }
--    {4, 2, 1},
--    {3, 3, 1},
+@@ -XXX,XX +XXX,XX @@ void unallocated_encoding(DisasContext *s)
--    {3, 3, 2},
+ static void gen_exception_el(DisasContext *s, int excp, uint32_t syn,
-+    {2, 2, 2},
+                              TCGv_i32 tcg_el)
-+    {1, 3, 1},
+ {
-+    {1, 3, 2},
+-    TCGv_i32 tcg_excp;
-     {3, 1, 1},
+-    TCGv_i32 tcg_syn;
-     {1, 1, 1},
+-
--    {2, 2, 1},
+     gen_set_condexec(s);
--    {2, 2, 2},
+     gen_set_pc_im(s, s->pc_curr);
-+    {1, 2, 1},
+-    tcg_excp = tcg_const_i32(excp);
-+    {1, 2, 2},
+-    tcg_syn = tcg_const_i32(syn);
-     {2, 1, 1}
+-    gen_helper_exception_with_syndrome(cpu_env, tcg_excp, tcg_syn, tcg_el);
- };
+-    tcg_temp_free_i32(tcg_syn);
+-    tcg_temp_free_i32(tcg_excp);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
++    gen_helper_exception_with_syndrome(cpu_env,
-     int shift;
++                                       tcg_constant_i32(excp),
-     int n;
++                                       tcg_constant_i32(syn), tcg_el);
-     int vec_size;
+     s->base.is_jmp = DISAS_NORETURN;
-+    int mmu_idx;
+ }
-+    TCGMemOp endian;
      TCGv_i32 addr;
      TCGv_i32 tmp;
      TCGv_i32 tmp2;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
      rn = (insn >> 16) & 0xf;
      rm = insn & 0xf;
      load = (insn & (1 << 21)) != 0;
 +    endian = s->be_data;
 +    mmu_idx = get_mem_index(s);
      if ((insn & (1 << 23)) == 0) {
          /* Load store all elements.  */
          op = (insn >> 8) & 0xf;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
          nregs = neon_ls_element_type[op].nregs;
          interleave = neon_ls_element_type[op].interleave;
          spacing = neon_ls_element_type[op].spacing;
 -        if (size == 3 && (interleave | spacing) != 1)
 +        if (size == 3 && (interleave | spacing) != 1) {
              return 1;
 +        }
 +        tmp64 = tcg_temp_new_i64();
          addr = tcg_temp_new_i32();
 +        tmp2 = tcg_const_i32(1 << size);
          load_reg_var(s, addr, rn);
 -        stride = (1 << size) * interleave;
          for (reg = 0; reg < nregs; reg++) {
 -            if (interleave > 2 || (interleave == 2 && nregs == 2)) {
 -                load_reg_var(s, addr, rn);
 -                tcg_gen_addi_i32(addr, addr, (1 << size) * reg);
 -            } else if (interleave == 2 && nregs == 4 && reg == 2) {
 -                load_reg_var(s, addr, rn);
 -                tcg_gen_addi_i32(addr, addr, 1 << size);
 -            }
 -            if (size == 3) {
 -                tmp64 = tcg_temp_new_i64();
 -                if (load) {
 -                    gen_aa32_ld64(s, tmp64, addr, get_mem_index(s));
 -                    neon_store_reg64(tmp64, rd);
 -                } else {
 -                    neon_load_reg64(tmp64, rd);
 -                    gen_aa32_st64(s, tmp64, addr, get_mem_index(s));
 -                }
 -                tcg_temp_free_i64(tmp64);
 -                tcg_gen_addi_i32(addr, addr, stride);
 -            } else {
 -                for (pass = 0; pass < 2; pass++) {
 -                    if (size == 2) {
 -                        if (load) {
 -                            tmp = tcg_temp_new_i32();
 -                            gen_aa32_ld32u(s, tmp, addr, get_mem_index(s));
 -                            neon_store_reg(rd, pass, tmp);
 -                        } else {
 -                            tmp = neon_load_reg(rd, pass);
 -                            gen_aa32_st32(s, tmp, addr, get_mem_index(s));
 -                            tcg_temp_free_i32(tmp);
 -                        }
 -                        tcg_gen_addi_i32(addr, addr, stride);
 -                    } else if (size == 1) {
 -                        if (load) {
 -                            tmp = tcg_temp_new_i32();
 -                            gen_aa32_ld16u(s, tmp, addr, get_mem_index(s));
 -                            tcg_gen_addi_i32(addr, addr, stride);
 -                            tmp2 = tcg_temp_new_i32();
 -                            gen_aa32_ld16u(s, tmp2, addr, get_mem_index(s));
 -                            tcg_gen_addi_i32(addr, addr, stride);
 -                            tcg_gen_shli_i32(tmp2, tmp2, 16);
 -                            tcg_gen_or_i32(tmp, tmp, tmp2);
 -                            tcg_temp_free_i32(tmp2);
 -                            neon_store_reg(rd, pass, tmp);
 -                        } else {
 -                            tmp = neon_load_reg(rd, pass);
 -                            tmp2 = tcg_temp_new_i32();
 -                            tcg_gen_shri_i32(tmp2, tmp, 16);
 -                            gen_aa32_st16(s, tmp, addr, get_mem_index(s));
 -                            tcg_temp_free_i32(tmp);
 -                            tcg_gen_addi_i32(addr, addr, stride);
 -                            gen_aa32_st16(s, tmp2, addr, get_mem_index(s));
 -                            tcg_temp_free_i32(tmp2);
 -                            tcg_gen_addi_i32(addr, addr, stride);
 -                        }
 -                    } else /* size == 0 */ {
 -                        if (load) {
 -                            tmp2 = NULL;
 -                            for (n = 0; n < 4; n++) {
 -                                tmp = tcg_temp_new_i32();
 -                                gen_aa32_ld8u(s, tmp, addr, get_mem_index(s));
 -                                tcg_gen_addi_i32(addr, addr, stride);
 -                                if (n == 0) {
 -                                    tmp2 = tmp;
 -                                } else {
 -                                    tcg_gen_shli_i32(tmp, tmp, n * 8);
 -                                    tcg_gen_or_i32(tmp2, tmp2, tmp);
 -                                    tcg_temp_free_i32(tmp);
 -                                }
 -                            }
 -                            neon_store_reg(rd, pass, tmp2);
 -                        } else {
 -                            tmp2 = neon_load_reg(rd, pass);
 -                            for (n = 0; n < 4; n++) {
 -                                tmp = tcg_temp_new_i32();
 -                                if (n == 0) {
 -                                    tcg_gen_mov_i32(tmp, tmp2);
 -                                } else {
 -                                    tcg_gen_shri_i32(tmp, tmp2, n * 8);
 -                                }
 -                                gen_aa32_st8(s, tmp, addr, get_mem_index(s));
 -                                tcg_temp_free_i32(tmp);
 -                                tcg_gen_addi_i32(addr, addr, stride);
 -                            }
 -                            tcg_temp_free_i32(tmp2);
 -                        }
 +            for (n = 0; n < 8 >> size; n++) {
 +                int xs;
 +                for (xs = 0; xs < interleave; xs++) {
 +                    int tt = rd + reg + spacing * xs;
 +
 +                    if (load) {
 +                        gen_aa32_ld_i64(s, tmp64, addr, mmu_idx, endian | size);
 +                        neon_store_element64(tt, n, size, tmp64);
 +                    } else {
 +                        neon_load_element64(tmp64, tt, n, size);
 +                        gen_aa32_st_i64(s, tmp64, addr, mmu_idx, endian | size);
                      }
 +                    tcg_gen_add_i32(addr, addr, tmp2);
                  }
              }
 -            rd += spacing;
          }
          tcg_temp_free_i32(addr);
 -        stride = nregs * 8;
 +        tcg_temp_free_i32(tmp2);
 +        tcg_temp_free_i64(tmp64);
 +        stride = nregs * interleave * 8;
      } else {
          size = (insn >> 10) & 3;
          if (size == 3) {
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 30/45] target/arm: Use gvec for NEON_3R_VADD_VSUB insns
+[PULL 23/54] target/arm: Use tcg_constant for disas_iwmmxt_insn
 From: Richard Henderson <richard.henderson@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-10-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-24-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 29 ++++++++++-------------------
+ target/arm/translate.c | 25 ++++++++++---------------
-file changed, 10 insertions(+), 19 deletions(-)
+file changed, 10 insertions(+), 15 deletions(-)
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static int disas_iwmmxt_insn(DisasContext *s, uint32_t insn)
-                 break;
+         gen_op_iwmmxt_movq_M0_wRn(wrd);
-             }
+         switch ((insn >> 6) & 3) {
-             return 0;
+         case 0:
-+
+-            tmp2 = tcg_const_i32(0xff);
-+        case NEON_3R_VADD_VSUB:
+-            tmp3 = tcg_const_i32((insn & 7) << 3);
-+            if (u) {
++            tmp2 = tcg_constant_i32(0xff);
-+                tcg_gen_gvec_sub(size, rd_ofs, rn_ofs, rm_ofs,
++            tmp3 = tcg_constant_i32((insn & 7) << 3);
-+                                 vec_size, vec_size);
+             break;
-+            } else {
+         case 1:
-+                tcg_gen_gvec_add(size, rd_ofs, rn_ofs, rm_ofs,
+-            tmp2 = tcg_const_i32(0xffff);
-+                                 vec_size, vec_size);
+-            tmp3 = tcg_const_i32((insn & 3) << 4);
-+            }
++            tmp2 = tcg_constant_i32(0xffff);
-+            return 0;
++            tmp3 = tcg_constant_i32((insn & 3) << 4);
              break;
          case 2:
 -            tmp2 = tcg_const_i32(0xffffffff);
 -            tmp3 = tcg_const_i32((insn & 1) << 5);
 +            tmp2 = tcg_constant_i32(0xffffffff);
 +            tmp3 = tcg_constant_i32((insn & 1) << 5);
              break;
          default:
 -            tmp2 = NULL;
 -            tmp3 = NULL;
 +            g_assert_not_reached();
          }
-         if (size == 3) {
+         gen_helper_iwmmxt_insr(cpu_M0, cpu_M0, tmp, tmp2, tmp3);
-             /* 64-bit element instructions. */
+-        tcg_temp_free_i32(tmp3);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+-        tcg_temp_free_i32(tmp2);
-                                                   cpu_V1, cpu_V0);
+         tcg_temp_free_i32(tmp);
-                     }
+         gen_op_iwmmxt_movq_wRn_M0(wrd);
-                     break;
+         gen_op_iwmmxt_set_mup();
--                case NEON_3R_VADD_VSUB:
+@@ -XXX,XX +XXX,XX @@ static int disas_iwmmxt_insn(DisasContext *s, uint32_t insn)
--                    if (u) {
+         rd0 = (insn >> 16) & 0xf;
--                        tcg_gen_sub_i64(CPU_V001);
+         rd1 = (insn >> 0) & 0xf;
--                    } else {
+         gen_op_iwmmxt_movq_M0_wRn(rd0);
--                        tcg_gen_add_i64(CPU_V001);
+-        tmp = tcg_const_i32((insn >> 20) & 3);
--                    }
+         iwmmxt_load_reg(cpu_V1, rd1);
--                    break;
+-        gen_helper_iwmmxt_align(cpu_M0, cpu_M0, cpu_V1, tmp);
-                 default:
+-        tcg_temp_free_i32(tmp);
-                     abort();
++        gen_helper_iwmmxt_align(cpu_M0, cpu_M0, cpu_V1,
-                 }
++                                tcg_constant_i32((insn >> 20) & 3));
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+         gen_op_iwmmxt_movq_wRn_M0(wrd);
-             tmp2 = neon_load_reg(rd, pass);
+         gen_op_iwmmxt_set_mup();
-             gen_neon_add(size, tmp, tmp2);
+         break;
-             break;
+@@ -XXX,XX +XXX,XX @@ static int disas_iwmmxt_insn(DisasContext *s, uint32_t insn)
--        case NEON_3R_VADD_VSUB:
+         wrd = (insn >> 12) & 0xf;
--            if (!u) { /* VADD */
+         rd0 = (insn >> 16) & 0xf;
--                gen_neon_add(size, tmp, tmp2);
+         gen_op_iwmmxt_movq_M0_wRn(rd0);
--            } else { /* VSUB */
+-        tmp = tcg_const_i32(((insn >> 16) & 0xf0) | (insn & 0x0f));
--                switch (size) {
++        tmp = tcg_constant_i32(((insn >> 16) & 0xf0) | (insn & 0x0f));
--                case 0: gen_helper_neon_sub_u8(tmp, tmp, tmp2); break;
+         gen_helper_iwmmxt_shufh(cpu_M0, cpu_env, cpu_M0, tmp);
--                case 1: gen_helper_neon_sub_u16(tmp, tmp, tmp2); break;
+-        tcg_temp_free_i32(tmp);
--                case 2: tcg_gen_sub_i32(tmp, tmp, tmp2); break;
+         gen_op_iwmmxt_movq_wRn_M0(wrd);
--                default: abort();
+         gen_op_iwmmxt_set_mup();
--                }
+         gen_op_iwmmxt_set_cup();
 -            }
 -            break;
          case NEON_3R_VTST_VCEQ:
              if (!u) { /* VTST */
                  switch (size) {
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 11/45] target/arm: Improve debug logging of AArch32 exception return
+[PULL 24/54] target/arm: Use tcg_constant for gen_{msr,mrs}
-For AArch32, exception return happens through certain kinds
+From: Richard Henderson <richard.henderson@linaro.org>
 of CPSR write. We don't currently have any CPU_LOG_INT logging
 of these events (unlike AArch64, where we log in the ERET
 instruction). Add some suitable logging.
-This will log exception returns like this:
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Exception return from AArch32 hyp to usr PC 0x80100374
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Message-id: 20220426163043.100432-25-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/translate.c | 22 +++++++++-------------
 file changed, 9 insertions(+), 13 deletions(-)
-paralleling the existing logging in the exception_return
-helper for AArch64 exception returns:
-Exception return from AArch64 EL2 to AArch64 EL0 PC 0x8003045c
-Exception return from AArch64 EL2 to AArch32 EL0 PC 0x8003045c
-(Note that an AArch32 exception return can only be
-AArch32->AArch32, never to AArch64.)
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181012144235.19646-2-peter.maydell@linaro.org
----
- target/arm/internals.h | 18 ++++++++++++++++++
- target/arm/helper.c    | 10 ++++++++++
- target/arm/translate.c |  7 +------
-files changed, 29 insertions(+), 6 deletions(-)
-diff --git a/target/arm/internals.h b/target/arm/internals.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/internals.h
-+++ b/target/arm/internals.h
-@@ -XXX,XX +XXX,XX @@ static inline uint32_t v7m_sp_limit(CPUARMState *env)
-     }
- }
-+/**
-+ * aarch32_mode_name(): Return name of the AArch32 CPU mode
-+ * @psr: Program Status Register indicating CPU mode
-+ *
-+ * Returns, for debug logging purposes, a printable representation
-+ * of the AArch32 CPU mode ("svc", "usr", etc) as indicated by
-+ * the low bits of the specified PSR.
-+ */
-+static inline const char *aarch32_mode_name(uint32_t psr)
-+{
-+    static const char cpu_mode_names[16][4] = {
-+        "usr", "fiq", "irq", "svc", "???", "???", "mon", "abt",
-+        "???", "???", "hyp", "und", "???", "???", "???", "sys"
-+    };
-+
-+    return cpu_mode_names[psr & 0xf];
-+}
-+
- #endif
-diff --git a/target/arm/helper.c b/target/arm/helper.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
-+++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ void cpsr_write(CPUARMState *env, uint32_t val, uint32_t mask,
-                 mask |= CPSR_IL;
-                 val |= CPSR_IL;
-             }
-+            qemu_log_mask(LOG_GUEST_ERROR,
-+                          "Illegal AArch32 mode switch attempt from %s to %s\n",
-+                          aarch32_mode_name(env->uncached_cpsr),
-+                          aarch32_mode_name(val));
-         } else {
-+            qemu_log_mask(CPU_LOG_INT, "%s %s to %s PC 0x%" PRIx32 "\n",
-+                          write_type == CPSRWriteExceptionReturn ?
-+                          "Exception return from AArch32" :
-+                          "AArch32 mode switch from",
-+                          aarch32_mode_name(env->uncached_cpsr),
-+                          aarch32_mode_name(val), env->regs[15]);
-             switch_mode(env, val & CPSR_M);
-         }
-     }
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ void gen_intermediate_code(CPUState *cpu, TranslationBlock *tb)
+@@ -XXX,XX +XXX,XX @@ static bool msr_banked_access_decode(DisasContext *s, int r, int sysm, int rn,
-     translator_loop(ops, &dc.base, cpu, tb);
+                 tcg_gen_sextract_i32(tcg_el, tcg_el, ctz32(SCR_EEL2), 1);
                  tcg_gen_addi_i32(tcg_el, tcg_el, 3);
              } else {
 -                tcg_el = tcg_const_i32(3);
 +                tcg_el = tcg_constant_i32(3);
              }
              gen_exception_el(s, EXCP_UDEF, syn_uncategorized(), tcg_el);
@@ -XXX,XX +XXX,XX @@ undef:
  static void gen_msr_banked(DisasContext *s, int r, int sysm, int rn)
  {
 -    TCGv_i32 tcg_reg, tcg_tgtmode, tcg_regno;
 +    TCGv_i32 tcg_reg;
      int tgtmode = 0, regno = 0;
      if (!msr_banked_access_decode(s, r, sysm, rn, &tgtmode, &regno)) {
@@ -XXX,XX +XXX,XX @@ static void gen_msr_banked(DisasContext *s, int r, int sysm, int rn)
      gen_set_condexec(s);
      gen_set_pc_im(s, s->pc_curr);
      tcg_reg = load_reg(s, rn);
 -    tcg_tgtmode = tcg_const_i32(tgtmode);
 -    tcg_regno = tcg_const_i32(regno);
 -    gen_helper_msr_banked(cpu_env, tcg_reg, tcg_tgtmode, tcg_regno);
 -    tcg_temp_free_i32(tcg_tgtmode);
 -    tcg_temp_free_i32(tcg_regno);
 +    gen_helper_msr_banked(cpu_env, tcg_reg,
 +                          tcg_constant_i32(tgtmode),
 +                          tcg_constant_i32(regno));
      tcg_temp_free_i32(tcg_reg);
      s->base.is_jmp = DISAS_UPDATE_EXIT;
  }
--static const char *cpu_mode_names[16] = {
+ static void gen_mrs_banked(DisasContext *s, int r, int sysm, int rn)
 -  "usr", "fiq", "irq", "svc", "???", "???", "mon", "abt",
 -  "???", "???", "hyp", "und", "???", "???", "???", "sys"
 -};
 -
  void arm_cpu_dump_state(CPUState *cs, FILE *f, fprintf_function cpu_fprintf,
                          int flags)
  {
-@@ -XXX,XX +XXX,XX @@ void arm_cpu_dump_state(CPUState *cs, FILE *f, fprintf_function cpu_fprintf,
+-    TCGv_i32 tcg_reg, tcg_tgtmode, tcg_regno;
-                     psr & CPSR_V ? 'V' : '-',
++    TCGv_i32 tcg_reg;
-                     psr & CPSR_T ? 'T' : 'A',
+     int tgtmode = 0, regno = 0;
-                     ns_status,
--                    cpu_mode_names[psr & 0xf], (psr & 0x10) ? 32 : 26);
+     if (!msr_banked_access_decode(s, r, sysm, rn, &tgtmode, &regno)) {
-+                    aarch32_mode_name(psr), (psr & 0x10) ? 32 : 26);
+@@ -XXX,XX +XXX,XX @@ static void gen_mrs_banked(DisasContext *s, int r, int sysm, int rn)
-     }
+     gen_set_condexec(s);
+     gen_set_pc_im(s, s->pc_curr);
-     if (flags & CPU_DUMP_FPU) {
+     tcg_reg = tcg_temp_new_i32();
 -    tcg_tgtmode = tcg_const_i32(tgtmode);
 -    tcg_regno = tcg_const_i32(regno);
 -    gen_helper_mrs_banked(tcg_reg, cpu_env, tcg_tgtmode, tcg_regno);
 -    tcg_temp_free_i32(tcg_tgtmode);
 -    tcg_temp_free_i32(tcg_regno);
 +    gen_helper_mrs_banked(tcg_reg, cpu_env,
 +                          tcg_constant_i32(tgtmode),
 +                          tcg_constant_i32(regno));
      store_reg(s, rn, tcg_reg);
      s->base.is_jmp = DISAS_UPDATE_EXIT;
  }
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 38/45] target/arm: Use gvec for NEON VLD all lanes
+[PULL 25/54] target/arm: Use tcg_constant for vector shift expanders
 From: Richard Henderson <richard.henderson@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-18-richard.henderson@linaro.org
-[PMM: added parens in ?: expression]
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-26-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 81 ++++++++++++++----------------------------
+ target/arm/translate.c | 27 +++++++++------------------
-file changed, 26 insertions(+), 55 deletions(-)
+file changed, 9 insertions(+), 18 deletions(-)
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static void gen_vfp_msr(TCGv_i32 tmp)
+@@ -XXX,XX +XXX,XX @@ void gen_gvec_sqrdmlsh_qc(unsigned vece, uint32_t rd_ofs, uint32_t rn_ofs,
-     tcg_temp_free_i32(tmp);
+     }                                                                   \
      static void gen_##NAME##0_vec(unsigned vece, TCGv_vec d, TCGv_vec a) \
      {                                                                   \
 -        TCGv_vec zero = tcg_const_zeros_vec_matching(d);                \
 +        TCGv_vec zero = tcg_constant_vec_matching(d, vece, 0);          \
          tcg_gen_cmp_vec(COND, vece, d, a, zero);                        \
 -        tcg_temp_free_vec(zero);                                        \
      }                                                                   \
      void gen_gvec_##NAME##0(unsigned vece, uint32_t d, uint32_t m,      \
                              uint32_t opr_sz, uint32_t max_sz)           \
@@ -XXX,XX +XXX,XX @@ void gen_ushl_i32(TCGv_i32 dst, TCGv_i32 src, TCGv_i32 shift)
      TCGv_i32 rval = tcg_temp_new_i32();
      TCGv_i32 lsh = tcg_temp_new_i32();
      TCGv_i32 rsh = tcg_temp_new_i32();
 -    TCGv_i32 zero = tcg_const_i32(0);
 -    TCGv_i32 max = tcg_const_i32(32);
 +    TCGv_i32 zero = tcg_constant_i32(0);
 +    TCGv_i32 max = tcg_constant_i32(32);
      /*
       * Rely on the TCG guarantee that out of range shifts produce
@@ -XXX,XX +XXX,XX @@ void gen_ushl_i32(TCGv_i32 dst, TCGv_i32 src, TCGv_i32 shift)
      tcg_temp_free_i32(rval);
      tcg_temp_free_i32(lsh);
      tcg_temp_free_i32(rsh);
 -    tcg_temp_free_i32(zero);
 -    tcg_temp_free_i32(max);
  }
--static void gen_neon_dup_u8(TCGv_i32 var, int shift)
+ void gen_ushl_i64(TCGv_i64 dst, TCGv_i64 src, TCGv_i64 shift)
--{
+@@ -XXX,XX +XXX,XX @@ void gen_ushl_i64(TCGv_i64 dst, TCGv_i64 src, TCGv_i64 shift)
--    TCGv_i32 tmp = tcg_temp_new_i32();
+     TCGv_i64 rval = tcg_temp_new_i64();
--    if (shift)
+     TCGv_i64 lsh = tcg_temp_new_i64();
--        tcg_gen_shri_i32(var, var, shift);
+     TCGv_i64 rsh = tcg_temp_new_i64();
--    tcg_gen_ext8u_i32(var, var);
+-    TCGv_i64 zero = tcg_const_i64(0);
--    tcg_gen_shli_i32(tmp, var, 8);
+-    TCGv_i64 max = tcg_const_i64(64);
--    tcg_gen_or_i32(var, var, tmp);
++    TCGv_i64 zero = tcg_constant_i64(0);
--    tcg_gen_shli_i32(tmp, var, 16);
++    TCGv_i64 max = tcg_constant_i64(64);
--    tcg_gen_or_i32(var, var, tmp);
--    tcg_temp_free_i32(tmp);
+     /*
--}
+      * Rely on the TCG guarantee that out of range shifts produce
--
+@@ -XXX,XX +XXX,XX @@ void gen_ushl_i64(TCGv_i64 dst, TCGv_i64 src, TCGv_i64 shift)
- static void gen_neon_dup_low16(TCGv_i32 var)
+     tcg_temp_free_i64(rval);
- {
+     tcg_temp_free_i64(lsh);
-     TCGv_i32 tmp = tcg_temp_new_i32();
+     tcg_temp_free_i64(rsh);
-@@ -XXX,XX +XXX,XX @@ static void gen_neon_dup_high16(TCGv_i32 var)
+-    tcg_temp_free_i64(zero);
-     tcg_temp_free_i32(tmp);
+-    tcg_temp_free_i64(max);
  }
--static TCGv_i32 gen_load_and_replicate(DisasContext *s, TCGv_i32 addr, int size)
+ static void gen_ushl_vec(unsigned vece, TCGv_vec dst,
--{
+@@ -XXX,XX +XXX,XX @@ void gen_sshl_i32(TCGv_i32 dst, TCGv_i32 src, TCGv_i32 shift)
--    /* Load a single Neon element and replicate into a 32 bit TCG reg */
+     TCGv_i32 rval = tcg_temp_new_i32();
--    TCGv_i32 tmp = tcg_temp_new_i32();
+     TCGv_i32 lsh = tcg_temp_new_i32();
--    switch (size) {
+     TCGv_i32 rsh = tcg_temp_new_i32();
--    case 0:
+-    TCGv_i32 zero = tcg_const_i32(0);
--        gen_aa32_ld8u(s, tmp, addr, get_mem_index(s));
+-    TCGv_i32 max = tcg_const_i32(31);
--        gen_neon_dup_u8(tmp, 0);
++    TCGv_i32 zero = tcg_constant_i32(0);
--        break;
++    TCGv_i32 max = tcg_constant_i32(31);
--    case 1:
--        gen_aa32_ld16u(s, tmp, addr, get_mem_index(s));
+     /*
--        gen_neon_dup_low16(tmp);
+      * Rely on the TCG guarantee that out of range shifts produce
--        break;
+@@ -XXX,XX +XXX,XX @@ void gen_sshl_i32(TCGv_i32 dst, TCGv_i32 src, TCGv_i32 shift)
--    case 2:
+     tcg_temp_free_i32(rval);
--        gen_aa32_ld32u(s, tmp, addr, get_mem_index(s));
+     tcg_temp_free_i32(lsh);
--        break;
+     tcg_temp_free_i32(rsh);
--    default: /* Avoid compiler warnings.  */
+-    tcg_temp_free_i32(zero);
--        abort();
+-    tcg_temp_free_i32(max);
--    }
+ }
--    return tmp;
--}
+ void gen_sshl_i64(TCGv_i64 dst, TCGv_i64 src, TCGv_i64 shift)
--
+@@ -XXX,XX +XXX,XX @@ void gen_sshl_i64(TCGv_i64 dst, TCGv_i64 src, TCGv_i64 shift)
- static int handle_vsel(uint32_t insn, uint32_t rd, uint32_t rn, uint32_t rm,
+     TCGv_i64 rval = tcg_temp_new_i64();
-                        uint32_t dp)
+     TCGv_i64 lsh = tcg_temp_new_i64();
- {
+     TCGv_i64 rsh = tcg_temp_new_i64();
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
+-    TCGv_i64 zero = tcg_const_i64(0);
-     int load;
+-    TCGv_i64 max = tcg_const_i64(63);
-     int shift;
++    TCGv_i64 zero = tcg_constant_i64(0);
-     int n;
++    TCGv_i64 max = tcg_constant_i64(63);
-+    int vec_size;
-     TCGv_i32 addr;
+     /*
-     TCGv_i32 tmp;
+      * Rely on the TCG guarantee that out of range shifts produce
-     TCGv_i32 tmp2;
+@@ -XXX,XX +XXX,XX @@ void gen_sshl_i64(TCGv_i64 dst, TCGv_i64 src, TCGv_i64 shift)
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
+     tcg_temp_free_i64(rval);
-             }
+     tcg_temp_free_i64(lsh);
-             addr = tcg_temp_new_i32();
+     tcg_temp_free_i64(rsh);
-             load_reg_var(s, addr, rn);
+-    tcg_temp_free_i64(zero);
--            if (nregs == 1) {
+-    tcg_temp_free_i64(max);
--                /* VLD1 to all lanes: bit 5 indicates how many Dregs to write */
+ }
--                tmp = gen_load_and_replicate(s, addr, size);
--                tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd, 0));
+ static void gen_sshl_vec(unsigned vece, TCGv_vec dst,
 -                tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd, 1));
 -                if (insn & (1 << 5)) {
 -                    tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd + 1, 0));
 -                    tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd + 1, 1));
 -                }
 -                tcg_temp_free_i32(tmp);
 -            } else {
 -                /* VLD2/3/4 to all lanes: bit 5 indicates register stride */
 -                stride = (insn & (1 << 5)) ? 2 : 1;
 -                for (reg = 0; reg < nregs; reg++) {
 -                    tmp = gen_load_and_replicate(s, addr, size);
 -                    tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd, 0));
 -                    tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd, 1));
 -                    tcg_temp_free_i32(tmp);
 -                    tcg_gen_addi_i32(addr, addr, 1 << size);
 -                    rd += stride;
 +
 +            /* VLD1 to all lanes: bit 5 indicates how many Dregs to write.
 +             * VLD2/3/4 to all lanes: bit 5 indicates register stride.
 +             */
 +            stride = (insn & (1 << 5)) ? 2 : 1;
 +            vec_size = nregs == 1 ? stride * 8 : 8;
 +
 +            tmp = tcg_temp_new_i32();
 +            for (reg = 0; reg < nregs; reg++) {
 +                gen_aa32_ld_i32(s, tmp, addr, get_mem_index(s),
 +                                s->be_data | size);
 +                if ((rd & 1) && vec_size == 16) {
 +                    /* We cannot write 16 bytes at once because the
 +                     * destination is unaligned.
 +                     */
 +                    tcg_gen_gvec_dup_i32(size, neon_reg_offset(rd, 0),
 +                                         8, 8, tmp);
 +                    tcg_gen_gvec_mov(0, neon_reg_offset(rd + 1, 0),
 +                                     neon_reg_offset(rd, 0), 8, 8);
 +                } else {
 +                    tcg_gen_gvec_dup_i32(size, neon_reg_offset(rd, 0),
 +                                         vec_size, vec_size, tmp);
                  }
 +                tcg_gen_addi_i32(addr, addr, 1 << size);
 +                rd += stride;
              }
 +            tcg_temp_free_i32(tmp);
              tcg_temp_free_i32(addr);
              stride = (1 << size) * nregs;
          } else {
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 06/45] target/arm: Convert division from feature bits to isar0 tests
+[PULL 26/54] target/arm: Use tcg_constant for do_coproc_insn
 From: Richard Henderson <richard.henderson@linaro.org>
-Both arm and thumb2 division are controlled by the same ISAR field,
-which takes care of the arm implies thumb case.  Having M imply
-thumb2 division was wrong for cortex-m0, which is v6m and does not
-have thumb2 at all, much less thumb2 division.
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181016223115.24100-5-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-27-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.h       | 12 ++++++++++--
+ target/arm/translate.c | 43 +++++++++++++-----------------------------
- linux-user/elfload.c   |  4 ++--
+file changed, 13 insertions(+), 30 deletions(-)
  target/arm/cpu.c       | 10 +---------
  target/arm/translate.c |  4 ++--
 files changed, 15 insertions(+), 15 deletions(-)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
-+++ b/target/arm/cpu.h
-@@ -XXX,XX +XXX,XX @@ enum arm_features {
-     ARM_FEATURE_VFP3,
-     ARM_FEATURE_VFP_FP16,
-     ARM_FEATURE_NEON,
--    ARM_FEATURE_THUMB_DIV, /* divide supported in Thumb encoding */
-     ARM_FEATURE_M, /* Microcontroller profile.  */
-     ARM_FEATURE_OMAPCP, /* OMAP specific CP15 ops handling.  */
-     ARM_FEATURE_THUMB2EE,
-@@ -XXX,XX +XXX,XX @@ enum arm_features {
-     ARM_FEATURE_V5,
-     ARM_FEATURE_STRONGARM,
-     ARM_FEATURE_VAPA, /* cp15 VA to PA lookups */
--    ARM_FEATURE_ARM_DIV, /* divide supported in ARM encoding */
-     ARM_FEATURE_VFP4, /* VFPv4 (implies that NEON is v2) */
-     ARM_FEATURE_GENERIC_TIMER,
-     ARM_FEATURE_MVFR, /* Media and VFP Feature Registers 0 and 1 */
-@@ -XXX,XX +XXX,XX @@ extern const uint64_t pred_esz_masks[4];
- /*
-  * 32-bit feature tests via id registers.
-  */
-+static inline bool isar_feature_thumb_div(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar0, ID_ISAR0, DIVIDE) != 0;
-+}
-+
-+static inline bool isar_feature_arm_div(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar0, ID_ISAR0, DIVIDE) > 1;
-+}
-+
- static inline bool isar_feature_aa32_aes(const ARMISARegisters *id)
- {
-     return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) != 0;
-diff --git a/linux-user/elfload.c b/linux-user/elfload.c
-index XXXXXXX..XXXXXXX 100644
---- a/linux-user/elfload.c
-+++ b/linux-user/elfload.c
-@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
-     GET_FEATURE(ARM_FEATURE_VFP3, ARM_HWCAP_ARM_VFPv3);
-     GET_FEATURE(ARM_FEATURE_V6K, ARM_HWCAP_ARM_TLS);
-     GET_FEATURE(ARM_FEATURE_VFP4, ARM_HWCAP_ARM_VFPv4);
--    GET_FEATURE(ARM_FEATURE_ARM_DIV, ARM_HWCAP_ARM_IDIVA);
--    GET_FEATURE(ARM_FEATURE_THUMB_DIV, ARM_HWCAP_ARM_IDIVT);
-+    GET_FEATURE_ID(arm_div, ARM_HWCAP_ARM_IDIVA);
-+    GET_FEATURE_ID(thumb_div, ARM_HWCAP_ARM_IDIVT);
-     /* All QEMU's VFPv3 CPUs have 32 registers, see VFP_DREG in translate.c.
-      * Note that the ARM_HWCAP_ARM_VFPv3D16 bit is always the inverse of
-      * ARM_HWCAP_ARM_VFPD32 (and so always clear for QEMU); it is unrelated
-diff --git a/target/arm/cpu.c b/target/arm/cpu.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.c
-+++ b/target/arm/cpu.c
-@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
-          * Presence of EL2 itself is ARM_FEATURE_EL2, and of the
-          * Security Extensions is ARM_FEATURE_EL3.
-          */
--        set_feature(env, ARM_FEATURE_ARM_DIV);
-+        assert(cpu_isar_feature(arm_div, cpu));
-         set_feature(env, ARM_FEATURE_LPAE);
-         set_feature(env, ARM_FEATURE_V7);
-     }
-@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
-     if (arm_feature(env, ARM_FEATURE_V5)) {
-         set_feature(env, ARM_FEATURE_V4T);
-     }
--    if (arm_feature(env, ARM_FEATURE_M)) {
--        set_feature(env, ARM_FEATURE_THUMB_DIV);
--    }
--    if (arm_feature(env, ARM_FEATURE_ARM_DIV)) {
--        set_feature(env, ARM_FEATURE_THUMB_DIV);
--    }
-     if (arm_feature(env, ARM_FEATURE_VFP4)) {
-         set_feature(env, ARM_FEATURE_VFP3);
-         set_feature(env, ARM_FEATURE_VFP_FP16);
-@@ -XXX,XX +XXX,XX @@ static void cortex_r5_initfn(Object *obj)
-     ARMCPU *cpu = ARM_CPU(obj);
-     set_feature(&cpu->env, ARM_FEATURE_V7);
--    set_feature(&cpu->env, ARM_FEATURE_THUMB_DIV);
--    set_feature(&cpu->env, ARM_FEATURE_ARM_DIV);
-     set_feature(&cpu->env, ARM_FEATURE_V7MP);
-     set_feature(&cpu->env, ARM_FEATURE_PMSA);
-     cpu->midr = 0x411fc153; /* r1p3 */
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static void disas_arm_insn(DisasContext *s, unsigned int insn)
+@@ -XXX,XX +XXX,XX @@ static void do_coproc_insn(DisasContext *s, int cpnum, int is64,
-                     case 1:
+              * Note that on XScale all cp0..c13 registers do an access check
-                     case 3:
+              * call in order to handle c15_cpar.
-                         /* SDIV, UDIV */
+              */
--                        if (!arm_dc_feature(s, ARM_FEATURE_ARM_DIV)) {
+-            TCGv_ptr tmpptr;
-+                        if (!dc_isar_feature(arm_div, s)) {
+-            TCGv_i32 tcg_syn, tcg_isread;
-                             goto illegal_op;
+             uint32_t syndrome;
-                         }
-                         if (((insn >> 5) & 7) || (rd != 15)) {
+             /* Note that since we are an implementation which takes an
-@@ -XXX,XX +XXX,XX @@ static void disas_thumb2_insn(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static void do_coproc_insn(DisasContext *s, int cpnum, int is64,
-             tmp2 = load_reg(s, rm);
-             if ((op & 0x50) == 0x10) {
+             gen_set_condexec(s);
-                 /* sdiv, udiv */
+             gen_set_pc_im(s, s->pc_curr);
--                if (!arm_dc_feature(s, ARM_FEATURE_THUMB_DIV)) {
+-            tmpptr = tcg_const_ptr(ri);
-+                if (!dc_isar_feature(thumb_div, s)) {
+-            tcg_syn = tcg_const_i32(syndrome);
-                     goto illegal_op;
+-            tcg_isread = tcg_const_i32(isread);
 -            gen_helper_access_check_cp_reg(cpu_env, tmpptr, tcg_syn,
 -                                           tcg_isread);
 -            tcg_temp_free_ptr(tmpptr);
 -            tcg_temp_free_i32(tcg_syn);
 -            tcg_temp_free_i32(tcg_isread);
 +            gen_helper_access_check_cp_reg(cpu_env,
 +                                           tcg_constant_ptr(ri),
 +                                           tcg_constant_i32(syndrome),
 +                                           tcg_constant_i32(isread));
          } else if (ri->type & ARM_CP_RAISES_EXC) {
              /*
               * The readfn or writefn might raise an exception;
@@ -XXX,XX +XXX,XX @@ static void do_coproc_insn(DisasContext *s, int cpnum, int is64,
                  TCGv_i64 tmp64;
                  TCGv_i32 tmp;
                  if (ri->type & ARM_CP_CONST) {
 -                    tmp64 = tcg_const_i64(ri->resetvalue);
 +                    tmp64 = tcg_constant_i64(ri->resetvalue);
                  } else if (ri->readfn) {
 -                    TCGv_ptr tmpptr;
                      tmp64 = tcg_temp_new_i64();
 -                    tmpptr = tcg_const_ptr(ri);
 -                    gen_helper_get_cp_reg64(tmp64, cpu_env, tmpptr);
 -                    tcg_temp_free_ptr(tmpptr);
 +                    gen_helper_get_cp_reg64(tmp64, cpu_env,
 +                                            tcg_constant_ptr(ri));
                  } else {
                      tmp64 = tcg_temp_new_i64();
                      tcg_gen_ld_i64(tmp64, cpu_env, ri->fieldoffset);
@@ -XXX,XX +XXX,XX @@ static void do_coproc_insn(DisasContext *s, int cpnum, int is64,
              } else {
                  TCGv_i32 tmp;
                  if (ri->type & ARM_CP_CONST) {
 -                    tmp = tcg_const_i32(ri->resetvalue);
 +                    tmp = tcg_constant_i32(ri->resetvalue);
                  } else if (ri->readfn) {
 -                    TCGv_ptr tmpptr;
                      tmp = tcg_temp_new_i32();
 -                    tmpptr = tcg_const_ptr(ri);
 -                    gen_helper_get_cp_reg(tmp, cpu_env, tmpptr);
 -                    tcg_temp_free_ptr(tmpptr);
 +                    gen_helper_get_cp_reg(tmp, cpu_env, tcg_constant_ptr(ri));
                  } else {
                      tmp = load_cpu_offset(ri->fieldoffset);
                  }
-                 if (op & 0x20)
+@@ -XXX,XX +XXX,XX @@ static void do_coproc_insn(DisasContext *s, int cpnum, int is64,
                  tcg_temp_free_i32(tmplo);
                  tcg_temp_free_i32(tmphi);
                  if (ri->writefn) {
 -                    TCGv_ptr tmpptr = tcg_const_ptr(ri);
 -                    gen_helper_set_cp_reg64(cpu_env, tmpptr, tmp64);
 -                    tcg_temp_free_ptr(tmpptr);
 +                    gen_helper_set_cp_reg64(cpu_env, tcg_constant_ptr(ri),
 +                                            tmp64);
                  } else {
                      tcg_gen_st_i64(tmp64, cpu_env, ri->fieldoffset);
                  }
                  tcg_temp_free_i64(tmp64);
              } else {
 +                TCGv_i32 tmp = load_reg(s, rt);
                  if (ri->writefn) {
 -                    TCGv_i32 tmp;
 -                    TCGv_ptr tmpptr;
 -                    tmp = load_reg(s, rt);
 -                    tmpptr = tcg_const_ptr(ri);
 -                    gen_helper_set_cp_reg(cpu_env, tmpptr, tmp);
 -                    tcg_temp_free_ptr(tmpptr);
 +                    gen_helper_set_cp_reg(cpu_env, tcg_constant_ptr(ri), tmp);
                      tcg_temp_free_i32(tmp);
                  } else {
 -                    TCGv_i32 tmp = load_reg(s, rt);
                      store_cpu_offset(tmp, ri->fieldoffset, 4);
                  }
              }
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 40/45] target/arm: Promote consecutive memory ops for aa32
+[PULL 27/54] target/arm: Use tcg_constant for gen_srs
 From: Richard Henderson <richard.henderson@linaro.org>
-For a sequence of loads or stores from a single register,
-little-endian operations can be promoted to an 8-byte op.
-This can reduce the number of operations by a factor of 8.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-20-richard.henderson@linaro.org
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-28-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 10 ++++++++++
+ target/arm/translate.c | 8 ++------
-file changed, 10 insertions(+)
+file changed, 2 insertions(+), 6 deletions(-)
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static void gen_srs(DisasContext *s,
-         if (size == 3 && (interleave | spacing) != 1) {
+     }
-             return 1;
      addr = tcg_temp_new_i32();
 -    tmp = tcg_const_i32(mode);
      /* get_r13_banked() will raise an exception if called from System mode */
      gen_set_condexec(s);
      gen_set_pc_im(s, s->pc_curr);
 -    gen_helper_get_r13_banked(addr, cpu_env, tmp);
 -    tcg_temp_free_i32(tmp);
 +    gen_helper_get_r13_banked(addr, cpu_env, tcg_constant_i32(mode));
      switch (amode) {
      case 0: /* DA */
          offset = -4;
@@ -XXX,XX +XXX,XX @@ static void gen_srs(DisasContext *s,
              abort();
          }
-+        /* For our purposes, bytes are always little-endian.  */
+         tcg_gen_addi_i32(addr, addr, offset);
-+        if (size == 0) {
+-        tmp = tcg_const_i32(mode);
-+            endian = MO_LE;
+-        gen_helper_set_r13_banked(cpu_env, tmp, addr);
-+        }
+-        tcg_temp_free_i32(tmp);
-+        /* Consecutive little-endian elements from a single register
++        gen_helper_set_r13_banked(cpu_env, tcg_constant_i32(mode), addr);
-+         * can be promoted to a larger little-endian operation.
+     }
-+         */
+     tcg_temp_free_i32(addr);
-+        if (interleave == 1 && endian == MO_LE) {
+     s->base.is_jmp = DISAS_UPDATE_EXIT;
 +            size = 3;
 +        }
          tmp64 = tcg_temp_new_i64();
          addr = tcg_temp_new_i32();
          tmp2 = tcg_const_i32(1 << size);
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 41/45] target/arm: Reorg NEON VLD/VST single element to one lane
+[PULL 28/54] target/arm: Use tcg_constant for op_s_{rri,rxi}_rot
 From: Richard Henderson <richard.henderson@linaro.org>
-Instead of shifts and masks, use direct loads and stores from
-the neon register file.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-21-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-29-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 92 +++++++++++++++++++++++-------------------
+ target/arm/translate.c | 11 +++++------
-file changed, 50 insertions(+), 42 deletions(-)
+file changed, 5 insertions(+), 6 deletions(-)
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static TCGv_i32 neon_load_reg(int reg, int pass)
+@@ -XXX,XX +XXX,XX @@ static bool op_s_rri_rot(DisasContext *s, arg_s_rri_rot *a,
-     return tmp;
+                          void (*gen)(TCGv_i32, TCGv_i32, TCGv_i32),
- }
+                          int logic_cc, StoreRegKind kind)
+ {
-+static void neon_load_element(TCGv_i32 var, int reg, int ele, TCGMemOp mop)
+-    TCGv_i32 tmp1, tmp2;
-+{
++    TCGv_i32 tmp1;
-+    long offset = neon_element_offset(reg, ele, mop & MO_SIZE);
+     uint32_t imm;
      imm = ror32(a->imm, a->rot);
      if (logic_cc && a->rot) {
          tcg_gen_movi_i32(cpu_CF, imm >> 31);
      }
 -    tmp2 = tcg_const_i32(imm);
      tmp1 = load_reg(s, a->rn);
 -    gen(tmp1, tmp1, tmp2);
 -    tcg_temp_free_i32(tmp2);
 +    gen(tmp1, tmp1, tcg_constant_i32(imm));
      if (logic_cc) {
          gen_logic_CC(tmp1);
@@ -XXX,XX +XXX,XX @@ static bool op_s_rxi_rot(DisasContext *s, arg_s_rri_rot *a,
      if (logic_cc && a->rot) {
          tcg_gen_movi_i32(cpu_CF, imm >> 31);
      }
 -    tmp = tcg_const_i32(imm);
 -    gen(tmp, tmp);
 +    tmp = tcg_temp_new_i32();
 +    gen(tmp, tcg_constant_i32(imm));
 +
-+    switch (mop) {
+     if (logic_cc) {
-+    case MO_UB:
+         gen_logic_CC(tmp);
 +        tcg_gen_ld8u_i32(var, cpu_env, offset);
 +        break;
 +    case MO_UW:
 +        tcg_gen_ld16u_i32(var, cpu_env, offset);
 +        break;
 +    case MO_UL:
 +        tcg_gen_ld_i32(var, cpu_env, offset);
 +        break;
 +    default:
 +        g_assert_not_reached();
 +    }
 +}
 +
  static void neon_load_element64(TCGv_i64 var, int reg, int ele, TCGMemOp mop)
  {
      long offset = neon_element_offset(reg, ele, mop & MO_SIZE);
@@ -XXX,XX +XXX,XX @@ static void neon_store_reg(int reg, int pass, TCGv_i32 var)
      tcg_temp_free_i32(var);
  }
 +static void neon_store_element(int reg, int ele, TCGMemOp size, TCGv_i32 var)
 +{
 +    long offset = neon_element_offset(reg, ele, size);
 +
 +    switch (size) {
 +    case MO_8:
 +        tcg_gen_st8_i32(var, cpu_env, offset);
 +        break;
 +    case MO_16:
 +        tcg_gen_st16_i32(var, cpu_env, offset);
 +        break;
 +    case MO_32:
 +        tcg_gen_st_i32(var, cpu_env, offset);
 +        break;
 +    default:
 +        g_assert_not_reached();
 +    }
 +}
 +
  static void neon_store_element64(int reg, int ele, TCGMemOp size, TCGv_i64 var)
  {
      long offset = neon_element_offset(reg, ele, size);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
      int stride;
      int size;
      int reg;
 -    int pass;
      int load;
 -    int shift;
      int n;
      int vec_size;
      int mmu_idx;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
          } else {
              /* Single element.  */
              int idx = (insn >> 4) & 0xf;
 -            pass = (insn >> 7) & 1;
 +            int reg_idx;
              switch (size) {
              case 0:
 -                shift = ((insn >> 5) & 3) * 8;
 +                reg_idx = (insn >> 5) & 7;
                  stride = 1;
                  break;
              case 1:
 -                shift = ((insn >> 6) & 1) * 16;
 +                reg_idx = (insn >> 6) & 3;
                  stride = (insn & (1 << 5)) ? 2 : 1;
                  break;
              case 2:
 -                shift = 0;
 +                reg_idx = (insn >> 7) & 1;
                  stride = (insn & (1 << 6)) ? 2 : 1;
                  break;
              default:
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
                   */
                  return 1;
              }
 +            tmp = tcg_temp_new_i32();
              addr = tcg_temp_new_i32();
              load_reg_var(s, addr, rn);
              for (reg = 0; reg < nregs; reg++) {
                  if (load) {
 -                    tmp = tcg_temp_new_i32();
 -                    switch (size) {
 -                    case 0:
 -                        gen_aa32_ld8u(s, tmp, addr, get_mem_index(s));
 -                        break;
 -                    case 1:
 -                        gen_aa32_ld16u(s, tmp, addr, get_mem_index(s));
 -                        break;
 -                    case 2:
 -                        gen_aa32_ld32u(s, tmp, addr, get_mem_index(s));
 -                        break;
 -                    default: /* Avoid compiler warnings.  */
 -                        abort();
 -                    }
 -                    if (size != 2) {
 -                        tmp2 = neon_load_reg(rd, pass);
 -                        tcg_gen_deposit_i32(tmp, tmp2, tmp,
 -                                            shift, size ? 16 : 8);
 -                        tcg_temp_free_i32(tmp2);
 -                    }
 -                    neon_store_reg(rd, pass, tmp);
 +                    gen_aa32_ld_i32(s, tmp, addr, get_mem_index(s),
 +                                    s->be_data | size);
 +                    neon_store_element(rd, reg_idx, size, tmp);
                  } else { /* Store */
 -                    tmp = neon_load_reg(rd, pass);
 -                    if (shift)
 -                        tcg_gen_shri_i32(tmp, tmp, shift);
 -                    switch (size) {
 -                    case 0:
 -                        gen_aa32_st8(s, tmp, addr, get_mem_index(s));
 -                        break;
 -                    case 1:
 -                        gen_aa32_st16(s, tmp, addr, get_mem_index(s));
 -                        break;
 -                    case 2:
 -                        gen_aa32_st32(s, tmp, addr, get_mem_index(s));
 -                        break;
 -                    }
 -                    tcg_temp_free_i32(tmp);
 +                    neon_load_element(tmp, rd, reg_idx, size);
 +                    gen_aa32_st_i32(s, tmp, addr, get_mem_index(s),
 +                                    s->be_data | size);
                  }
                  rd += stride;
                  tcg_gen_addi_i32(addr, addr, 1 << size);
              }
              tcg_temp_free_i32(addr);
 +            tcg_temp_free_i32(tmp);
              stride = nregs * (1 << size);
          }
      }
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 27/45] target/arm: Use gvec for NEON VDUP
+[PULL 29/54] target/arm: Use tcg_constant for MOVW, UMAAL, CRC32
 From: Richard Henderson <richard.henderson@linaro.org>
-Also introduces neon_element_offset to find the env offset
-of a specific element within a neon register.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-7-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-30-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 63 ++++++++++++++++++++++++------------------
+ target/arm/translate.c | 11 +++--------
-file changed, 36 insertions(+), 27 deletions(-)
+file changed, 3 insertions(+), 8 deletions(-)
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ neon_reg_offset (int reg, int n)
+@@ -XXX,XX +XXX,XX @@ static bool trans_ADR(DisasContext *s, arg_ri *a)
-     return vfp_reg_offset(0, sreg);
  static bool trans_MOVW(DisasContext *s, arg_MOVW *a)
  {
 -    TCGv_i32 tmp;
 -
      if (!ENABLE_ARCH_6T2) {
          return false;
      }
 -    tmp = tcg_const_i32(a->imm);
 -    store_reg(s, a->rd, tmp);
 +    store_reg(s, a->rd, tcg_constant_i32(a->imm));
      return true;
  }
-+/* Return the offset of a 2**SIZE piece of a NEON register, at index ELE,
+@@ -XXX,XX +XXX,XX @@ static bool trans_UMAAL(DisasContext *s, arg_UMAAL *a)
-+ * where 0 is the least significant end of the register.
+     t0 = load_reg(s, a->rm);
-+ */
+     t1 = load_reg(s, a->rn);
-+static inline long
+     tcg_gen_mulu2_i32(t0, t1, t0, t1);
-+neon_element_offset(int reg, int element, TCGMemOp size)
+-    zero = tcg_const_i32(0);
-+{
++    zero = tcg_constant_i32(0);
-+    int element_size = 1 << size;
+     t2 = load_reg(s, a->ra);
-+    int ofs = element * element_size;
+     tcg_gen_add2_i32(t0, t1, t0, t1, t2, zero);
-+#ifdef HOST_WORDS_BIGENDIAN
+     tcg_temp_free_i32(t2);
-+    /* Calculate the offset assuming fully little-endian,
+     t2 = load_reg(s, a->rd);
-+     * then XOR to account for the order of the 8-byte units.
+     tcg_gen_add2_i32(t0, t1, t0, t1, t2, zero);
-+     */
+     tcg_temp_free_i32(t2);
-+    if (element_size < 8) {
+-    tcg_temp_free_i32(zero);
-+        ofs ^= 8 - element_size;
+     store_reg(s, a->ra, t0);
-+    }
+     store_reg(s, a->rd, t1);
-+#endif
+     return true;
-+    return neon_reg_offset(reg, 0) + ofs;
+@@ -XXX,XX +XXX,XX @@ static bool op_crc32(DisasContext *s, arg_rrr *a, bool c, MemOp sz)
-+}
+     default:
-+
+         g_assert_not_reached();
- static TCGv_i32 neon_load_reg(int reg, int pass)
+     }
- {
+-    t3 = tcg_const_i32(1 << sz);
-     TCGv_i32 tmp = tcg_temp_new_i32();
++    t3 = tcg_constant_i32(1 << sz);
-@@ -XXX,XX +XXX,XX @@ static int disas_vfp_insn(DisasContext *s, uint32_t insn)
+     if (c) {
-                     tmp = load_reg(s, rd);
+         gen_helper_crc32c(t1, t1, t2, t3);
-                     if (insn & (1 << 23)) {
+     } else {
-                         /* VDUP */
+         gen_helper_crc32(t1, t1, t2, t3);
--                        if (size == 0) {
+     }
--                            gen_neon_dup_u8(tmp, 0);
+     tcg_temp_free_i32(t2);
--                        } else if (size == 1) {
+-    tcg_temp_free_i32(t3);
--                            gen_neon_dup_low16(tmp);
+     store_reg(s, a->rd, t1);
--                        }
+     return true;
--                        for (n = 0; n <= pass * 2; n++) {
+ }
 -                            tmp2 = tcg_temp_new_i32();
 -                            tcg_gen_mov_i32(tmp2, tmp);
 -                            neon_store_reg(rn, n, tmp2);
 -                        }
 -                        neon_store_reg(rn, n, tmp);
 +                        int vec_size = pass ? 16 : 8;
 +                        tcg_gen_gvec_dup_i32(size, neon_reg_offset(rn, 0),
 +                                             vec_size, vec_size, tmp);
 +                        tcg_temp_free_i32(tmp);
                      } else {
                          /* VMOV */
                          switch (size) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                  tcg_temp_free_i32(tmp);
              } else if ((insn & 0x380) == 0) {
                  /* VDUP */
 +                int element;
 +                TCGMemOp size;
 +
                  if ((insn & (7 << 16)) == 0 || (q && (rd & 1))) {
                      return 1;
                  }
 -                if (insn & (1 << 19)) {
 -                    tmp = neon_load_reg(rm, 1);
 -                } else {
 -                    tmp = neon_load_reg(rm, 0);
 -                }
                  if (insn & (1 << 16)) {
 -                    gen_neon_dup_u8(tmp, ((insn >> 17) & 3) * 8);
 +                    size = MO_8;
 +                    element = (insn >> 17) & 7;
                  } else if (insn & (1 << 17)) {
 -                    if ((insn >> 18) & 1)
 -                        gen_neon_dup_high16(tmp);
 -                    else
 -                        gen_neon_dup_low16(tmp);
 +                    size = MO_16;
 +                    element = (insn >> 18) & 3;
 +                } else {
 +                    size = MO_32;
 +                    element = (insn >> 19) & 1;
                  }
 -                for (pass = 0; pass < (q ? 4 : 2); pass++) {
 -                    tmp2 = tcg_temp_new_i32();
 -                    tcg_gen_mov_i32(tmp2, tmp);
 -                    neon_store_reg(rd, pass, tmp2);
 -                }
 -                tcg_temp_free_i32(tmp);
 +                tcg_gen_gvec_dup_mem(size, neon_reg_offset(rd, 0),
 +                                     neon_element_offset(rm, element, size),
 +                                     q ? 16 : 8, q ? 16 : 8);
              } else {
                  return 1;
              }
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 33/45] target/arm: Use gvec for VSHR, VSHL
+[PULL 30/54] target/arm: Use tcg_constant for v7m MRS, MSR
 From: Richard Henderson <richard.henderson@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-13-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-31-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 70 +++++++++++++++++++++++++++++-------------
+ target/arm/translate.c | 7 +++----
-file changed, 48 insertions(+), 22 deletions(-)
+file changed, 3 insertions(+), 4 deletions(-)
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static bool trans_MRS_v7m(DisasContext *s, arg_MRS_v7m *a)
-                     size--;
+     if (!arm_dc_feature(s, ARM_FEATURE_M)) {
-             }
+         return false;
-             shift = (insn >> 16) & ((1 << (3 + size)) - 1);
+     }
--            /* To avoid excessive duplication of ops we implement shift
+-    tmp = tcg_const_i32(a->sysm);
--               by immediate using the variable shift operations.  */
+-    gen_helper_v7m_mrs(tmp, cpu_env, tmp);
-             if (op < 8) {
++    tmp = tcg_temp_new_i32();
-                 /* Shift by immediate:
++    gen_helper_v7m_mrs(tmp, cpu_env, tcg_constant_i32(a->sysm));
-                    VSHR, VSRA, VRSHR, VRSRA, VSRI, VSHL, VQSHL, VQSHLU.  */
+     store_reg(s, a->rd, tmp);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+     return true;
-                 }
+ }
-                 /* Right shifts are encoded as N - shift, where N is the
+@@ -XXX,XX +XXX,XX @@ static bool trans_MSR_v7m(DisasContext *s, arg_MSR_v7m *a)
-                    element size in bits.  */
+     if (!arm_dc_feature(s, ARM_FEATURE_M)) {
--                if (op <= 4)
+         return false;
-+                if (op <= 4) {
+     }
-                     shift = shift - (1 << (size + 3));
+-    addr = tcg_const_i32((a->mask << 10) | a->sysm);
-+                }
++    addr = tcg_constant_i32((a->mask << 10) | a->sysm);
-+
+     reg = load_reg(s, a->rn);
-+                switch (op) {
+     gen_helper_v7m_msr(cpu_env, addr, reg);
-+                case 0:  /* VSHR */
+-    tcg_temp_free_i32(addr);
-+                    /* Right shift comes here negative.  */
+     tcg_temp_free_i32(reg);
-+                    shift = -shift;
+     /* If we wrote to CONTROL, the EL might have changed */
-+                    /* Shifts larger than the element size are architecturally
+     gen_rebuild_hflags(s, true);
 +                     * valid.  Unsigned results in all zeros; signed results
 +                     * in all sign bits.
 +                     */
 +                    if (!u) {
 +                        tcg_gen_gvec_sari(size, rd_ofs, rm_ofs,
 +                                          MIN(shift, (8 << size) - 1),
 +                                          vec_size, vec_size);
 +                    } else if (shift >= 8 << size) {
 +                        tcg_gen_gvec_dup8i(rd_ofs, vec_size, vec_size, 0);
 +                    } else {
 +                        tcg_gen_gvec_shri(size, rd_ofs, rm_ofs, shift,
 +                                          vec_size, vec_size);
 +                    }
 +                    return 0;
 +
 +                case 5: /* VSHL, VSLI */
 +                    if (!u) { /* VSHL */
 +                        /* Shifts larger than the element size are
 +                         * architecturally valid and results in zero.
 +                         */
 +                        if (shift >= 8 << size) {
 +                            tcg_gen_gvec_dup8i(rd_ofs, vec_size, vec_size, 0);
 +                        } else {
 +                            tcg_gen_gvec_shli(size, rd_ofs, rm_ofs, shift,
 +                                              vec_size, vec_size);
 +                        }
 +                        return 0;
 +                    }
 +                    break;
 +                }
 +
                  if (size == 3) {
                      count = q + 1;
                  } else {
                      count = q ? 4: 2;
                  }
 -                switch (size) {
 -                case 0:
 -                    imm = (uint8_t) shift;
 -                    imm |= imm << 8;
 -                    imm |= imm << 16;
 -                    break;
 -                case 1:
 -                    imm = (uint16_t) shift;
 -                    imm |= imm << 16;
 -                    break;
 -                case 2:
 -                case 3:
 -                    imm = shift;
 -                    break;
 -                default:
 -                    abort();
 -                }
 +
 +                /* To avoid excessive duplication of ops we implement shift
 +                 * by immediate using the variable shift operations.
 +                  */
 +                imm = dup_const(size, shift);
                  for (pass = 0; pass < count; pass++) {
                      if (size == 3) {
                          neon_load_reg64(cpu_V0, rm + pass);
                          tcg_gen_movi_i64(cpu_V1, imm);
                          switch (op) {
 -                        case 0:  /* VSHR */
                          case 1:  /* VSRA */
                              if (u)
                                  gen_helper_neon_shl_u64(cpu_V0, cpu_V0, cpu_V1);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                                                           cpu_V0, cpu_V1);
                              }
                              break;
 +                        default:
 +                            g_assert_not_reached();
                          }
                          if (op == 1 || op == 3) {
                              /* Accumulate.  */
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                          tmp2 = tcg_temp_new_i32();
                          tcg_gen_movi_i32(tmp2, imm);
                          switch (op) {
 -                        case 0:  /* VSHR */
                          case 1:  /* VSRA */
                              GEN_NEON_INTEGER_OP(shl);
                              break;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                          case 7: /* VQSHL */
                              GEN_NEON_INTEGER_OP_ENV(qshl);
                              break;
 +                        default:
 +                            g_assert_not_reached();
                          }
                          tcg_temp_free_i32(tmp2);
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 20/45] target/arm: Report correct syndrome for FP/SIMD traps to Hyp mode
+[PULL 31/54] target/arm: Use tcg_constant for TT, SAT, SMMLA
-For traps of FP/SIMD instructions to AArch32 Hyp mode, the syndrome
+From: Richard Henderson <richard.henderson@linaro.org>
 provided in HSR has more information than is reported to AArch64.
 Specifically, there are extra fields TA and coproc which indicate
 whether the trapped instruction was FP or SIMD. Add this extra
 information to the syndromes we construct, and mask it out when
 taking the exception to AArch64.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-32-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181012144235.19646-11-peter.maydell@linaro.org
 ---
- target/arm/internals.h | 14 +++++++++++++-
+ target/arm/translate.c | 14 +++++---------
- target/arm/helper.c    |  9 +++++++++
+file changed, 5 insertions(+), 9 deletions(-)
  target/arm/translate.c |  8 ++++----
 files changed, 26 insertions(+), 5 deletions(-)
-diff --git a/target/arm/internals.h b/target/arm/internals.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/internals.h
-+++ b/target/arm/internals.h
-@@ -XXX,XX +XXX,XX @@ static inline uint32_t syn_get_ec(uint32_t syn)
-  * few cases the value in HSR for exceptions taken to AArch32 Hyp
-  * mode differs slightly, and we fix this up when populating HSR in
-  * arm_cpu_do_interrupt_aarch32_hyp().
-+ * The exception is FP/SIMD access traps -- these report extra information
-+ * when taking an exception to AArch32. For those we include the extra coproc
-+ * and TA fields, and mask them out when taking the exception to AArch64.
-  */
- static inline uint32_t syn_uncategorized(void)
- {
-@@ -XXX,XX +XXX,XX @@ static inline uint32_t syn_cp15_rrt_trap(int cv, int cond, int opc1, int crm,
- static inline uint32_t syn_fp_access_trap(int cv, int cond, bool is_16bit)
- {
-+    /* AArch32 FP trap or any AArch64 FP/SIMD trap: TA == 0 coproc == 0xa */
-     return (EC_ADVSIMDFPACCESSTRAP << ARM_EL_EC_SHIFT)
-         | (is_16bit ? 0 : ARM_EL_IL)
--        | (cv << 24) | (cond << 20);
-+        | (cv << 24) | (cond << 20) | 0xa;
-+}
-+
-+static inline uint32_t syn_simd_access_trap(int cv, int cond, bool is_16bit)
-+{
-+    /* AArch32 SIMD trap: TA == 1 coproc == 0 */
-+    return (EC_ADVSIMDFPACCESSTRAP << ARM_EL_EC_SHIFT)
-+        | (is_16bit ? 0 : ARM_EL_IL)
-+        | (cv << 24) | (cond << 20) | (1 << 5);
- }
- static inline uint32_t syn_sve_access_trap(void)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
-+++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ static void arm_cpu_do_interrupt_aarch64(CPUState *cs)
-     case EXCP_HVC:
-     case EXCP_HYP_TRAP:
-     case EXCP_SMC:
-+        if (syn_get_ec(env->exception.syndrome) == EC_ADVSIMDFPACCESSTRAP) {
-+            /*
-+             * QEMU internal FP/SIMD syndromes from AArch32 include the
-+             * TA and coproc fields which are only exposed if the exception
-+             * is taken to AArch32 Hyp mode. Mask them out to get a valid
-+             * AArch64 format syndrome.
-+             */
-+            env->exception.syndrome &= ~MAKE_64BIT_MASK(0, 20);
-+        }
-         env->cp15.esr_el[new_el] = env->exception.syndrome;
-         break;
-     case EXCP_IRQ:
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static bool trans_TT(DisasContext *s, arg_TT *a)
       */
      if (s->fp_excp_el) {
          gen_exception_insn(s, 4, EXCP_UDEF,
 -                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
 +                           syn_simd_access_trap(1, 0xe, false), s->fp_excp_el);
          return 0;
      }
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+     addr = load_reg(s, a->rn);
-      */
+-    tmp = tcg_const_i32((a->A << 1) | a->T);
-     if (s->fp_excp_el) {
+-    gen_helper_v7m_tt(tmp, cpu_env, addr, tmp);
-         gen_exception_insn(s, 4, EXCP_UDEF,
++    tmp = tcg_temp_new_i32();
--                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
++    gen_helper_v7m_tt(tmp, cpu_env, addr, tcg_constant_i32((a->A << 1) | a->T));
-+                           syn_simd_access_trap(1, 0xe, false), s->fp_excp_el);
+     tcg_temp_free_i32(addr);
-         return 0;
+     store_reg(s, a->rd, tmp);
      return true;
@@ -XXX,XX +XXX,XX @@ static bool trans_PKH(DisasContext *s, arg_PKH *a)
  static bool op_sat(DisasContext *s, arg_sat *a,
                     void (*gen)(TCGv_i32, TCGv_env, TCGv_i32, TCGv_i32))
  {
 -    TCGv_i32 tmp, satimm;
 +    TCGv_i32 tmp;
      int shift = a->imm;
      if (!ENABLE_ARCH_6) {
@@ -XXX,XX +XXX,XX @@ static bool op_sat(DisasContext *s, arg_sat *a,
          tcg_gen_shli_i32(tmp, tmp, shift);
      }
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
+-    satimm = tcg_const_i32(a->satimm);
+-    gen(tmp, cpu_env, tmp, satimm);
-     if (s->fp_excp_el) {
+-    tcg_temp_free_i32(satimm);
-         gen_exception_insn(s, 4, EXCP_UDEF,
++    gen(tmp, cpu_env, tmp, tcg_constant_i32(a->satimm));
--                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
-+                           syn_simd_access_trap(1, 0xe, false), s->fp_excp_el);
+     store_reg(s, a->rd, tmp);
-         return 0;
+     return true;
-     }
+@@ -XXX,XX +XXX,XX @@ static bool op_smmla(DisasContext *s, arg_rrrr *a, bool round, bool sub)
-     if (!s->vfp_enabled) {
+              * a non-zero multiplicand lowpart, and the correct result
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
+              * lowpart for rounding.
+              */
-     if (s->fp_excp_el) {
+-            TCGv_i32 zero = tcg_const_i32(0);
-         gen_exception_insn(s, 4, EXCP_UDEF,
+-            tcg_gen_sub2_i32(t2, t1, zero, t3, t2, t1);
--                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
+-            tcg_temp_free_i32(zero);
-+                           syn_simd_access_trap(1, 0xe, false), s->fp_excp_el);
++            tcg_gen_sub2_i32(t2, t1, tcg_constant_i32(0), t3, t2, t1);
-         return 0;
+         } else {
-     }
+             tcg_gen_add_i32(t1, t1, t3);
-     if (!s->vfp_enabled) {
+         }
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 32/45] target/arm: Use gvec for NEON_3R_VMUL
+[PULL 32/54] target/arm: Use tcg_constant in LDM, STM
 From: Richard Henderson <richard.henderson@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-12-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-33-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 31 +++++++++++++++----------------
+ target/arm/translate.c | 12 ++++--------
-file changed, 15 insertions(+), 16 deletions(-)
+file changed, 4 insertions(+), 8 deletions(-)
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static bool op_stm(DisasContext *s, arg_ldst_block *a, int min_n)
-                                  vec_size, vec_size);
+ {
-             }
+     int i, j, n, list, mem_idx;
-             return 0;
+     bool user = a->u;
-+
+-    TCGv_i32 addr, tmp, tmp2;
-+        case NEON_3R_VMUL: /* VMUL */
++    TCGv_i32 addr, tmp;
-+            if (u) {
-+                /* Polynomial case allows only P8 and is handled below.  */
+     if (user) {
-+                if (size != 0) {
+         /* STM (user) */
-+                    return 1;
+@@ -XXX,XX +XXX,XX @@ static bool op_stm(DisasContext *s, arg_ldst_block *a, int min_n)
-+                }
-+            } else {
+         if (user && i != 15) {
-+                tcg_gen_gvec_mul(size, rd_ofs, rn_ofs, rm_ofs,
+             tmp = tcg_temp_new_i32();
-+                                 vec_size, vec_size);
+-            tmp2 = tcg_const_i32(i);
-+                return 0;
+-            gen_helper_get_user_reg(tmp, cpu_env, tmp2);
-+            }
+-            tcg_temp_free_i32(tmp2);
-+            break;
++            gen_helper_get_user_reg(tmp, cpu_env, tcg_constant_i32(i));
          } else {
              tmp = load_reg(s, i);
          }
-         if (size == 3) {
+@@ -XXX,XX +XXX,XX @@ static bool do_ldm(DisasContext *s, arg_ldst_block *a, int min_n)
-             /* 64-bit element instructions. */
+     bool loaded_base;
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+     bool user = a->u;
-                 return 1;
+     bool exc_return = false;
-             }
+-    TCGv_i32 addr, tmp, tmp2, loaded_var;
-             break;
++    TCGv_i32 addr, tmp, loaded_var;
--        case NEON_3R_VMUL:
--            if (u && (size != 0)) {
+     if (user) {
--                /* UNDEF on invalid size for polynomial subcase */
+         /* LDM (user), LDM (exception return) */
--                return 1;
+@@ -XXX,XX +XXX,XX @@ static bool do_ldm(DisasContext *s, arg_ldst_block *a, int min_n)
--            }
+         tmp = tcg_temp_new_i32();
--            break;
+         gen_aa32_ld_i32(s, tmp, addr, mem_idx, MO_UL | MO_ALIGN);
-         case NEON_3R_VFM_VQRDMLSH:
+         if (user) {
-             if (!arm_dc_feature(s, ARM_FEATURE_VFP4)) {
+-            tmp2 = tcg_const_i32(i);
-                 return 1;
+-            gen_helper_set_user_reg(cpu_env, tmp2, tmp);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+-            tcg_temp_free_i32(tmp2);
-             }
++            gen_helper_set_user_reg(cpu_env, tcg_constant_i32(i), tmp);
-             break;
+             tcg_temp_free_i32(tmp);
-         case NEON_3R_VMUL:
+         } else if (i == a->rn) {
--            if (u) { /* polynomial */
+             loaded_var = tmp;
 -                gen_helper_neon_mul_p8(tmp, tmp, tmp2);
 -            } else { /* Integer */
 -                switch (size) {
 -                case 0: gen_helper_neon_mul_u8(tmp, tmp, tmp2); break;
 -                case 1: gen_helper_neon_mul_u16(tmp, tmp, tmp2); break;
 -                case 2: tcg_gen_mul_i32(tmp, tmp, tmp2); break;
 -                default: abort();
 -                }
 -            }
 +            /* VMUL.P8; other cases already eliminated.  */
 +            gen_helper_neon_mul_p8(tmp, tmp, tmp2);
              break;
          case NEON_3R_VPMAX:
              GEN_NEON_INTEGER_OP(pmax);
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 31/45] target/arm: Use gvec for NEON_2RM_VMN, NEON_2RM_VNEG
+[PULL 33/54] target/arm: Use tcg_constant in CLRM, DLS, WLS, LE
 From: Richard Henderson <richard.henderson@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-11-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-34-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 16 ++++++++--------
+ target/arm/translate.c | 16 +++++-----------
-file changed, 8 insertions(+), 8 deletions(-)
+file changed, 5 insertions(+), 11 deletions(-)
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static bool trans_CLRM(DisasContext *s, arg_CLRM *a)
-                     tcg_temp_free_ptr(ptr1);
-                     tcg_temp_free_ptr(ptr2);
+     s->eci_handled = true;
-                     break;
-+
+-    zero = tcg_const_i32(0);
-+                case NEON_2RM_VMVN:
++    zero = tcg_constant_i32(0);
-+                    tcg_gen_gvec_not(0, rd_ofs, rm_ofs, vec_size, vec_size);
+     for (i = 0; i < 15; i++) {
-+                    break;
+         if (extract32(a->list, i, 1)) {
-+                case NEON_2RM_VNEG:
+             /* Clear R[i] */
-+                    tcg_gen_gvec_neg(size, rd_ofs, rm_ofs, vec_size, vec_size);
+@@ -XXX,XX +XXX,XX @@ static bool trans_CLRM(DisasContext *s, arg_CLRM *a)
-+                    break;
+          * Clear APSR (by calling the MSR helper with the same argument
-+
+          * as for "MSR APSR_nzcvqg, Rn": mask = 0b1100, SYSM=0)
-                 default:
+          */
-                 elementwise:
+-        TCGv_i32 maskreg = tcg_const_i32(0xc << 8);
-                     for (pass = 0; pass < (q ? 4 : 2); pass++) {
+-        gen_helper_v7m_msr(cpu_env, maskreg, zero);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+-        tcg_temp_free_i32(maskreg);
-                         case NEON_2RM_VCNT:
++        gen_helper_v7m_msr(cpu_env, tcg_constant_i32(0xc00), zero);
-                             gen_helper_neon_cnt_u8(tmp, tmp);
+     }
-                             break;
+-    tcg_temp_free_i32(zero);
--                        case NEON_2RM_VMVN:
+     clear_eci_state(s);
--                            tcg_gen_not_i32(tmp, tmp);
+     return true;
--                            break;
+ }
-                         case NEON_2RM_VQABS:
+@@ -XXX,XX +XXX,XX @@ static bool trans_DLS(DisasContext *s, arg_DLS *a)
-                             switch (size) {
+     store_reg(s, 14, tmp);
-                             case 0:
+     if (a->size != 4) {
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+         /* DLSTP: set FPSCR.LTPSIZE */
-                             default: abort();
+-        tmp = tcg_const_i32(a->size);
-                             }
+-        store_cpu_field(tmp, v7m.ltpsize);
-                             break;
++        store_cpu_field(tcg_constant_i32(a->size), v7m.ltpsize);
--                        case NEON_2RM_VNEG:
+         s->base.is_jmp = DISAS_UPDATE_NOCHAIN;
--                            tmp2 = tcg_const_i32(0);
+     }
--                            gen_neon_rsb(size, tmp, tmp2);
+     return true;
--                            tcg_temp_free_i32(tmp2);
+@@ -XXX,XX +XXX,XX @@ static bool trans_WLS(DisasContext *s, arg_WLS *a)
--                            break;
+          */
-                         case NEON_2RM_VCGT0_F:
+         bool ok = vfp_access_check(s);
-                         {
+         assert(ok);
-                             TCGv_ptr fpstatus = get_fpstatus_ptr(1);
+-        tmp = tcg_const_i32(a->size);
 -        store_cpu_field(tmp, v7m.ltpsize);
 +        store_cpu_field(tcg_constant_i32(a->size), v7m.ltpsize);
          /*
           * LTPSIZE updated, but MVE_NO_PRED will always be the same thing (0)
           * when we take this upcoming exit from this TB, so gen_jmp_tb() is OK.
@@ -XXX,XX +XXX,XX @@ static bool trans_LE(DisasContext *s, arg_LE *a)
      gen_set_label(loopend);
      if (a->tp) {
          /* Exits from tail-pred loops must reset LTPSIZE to 4 */
 -        tmp = tcg_const_i32(4);
 -        store_cpu_field(tmp, v7m.ltpsize);
 +        store_cpu_field(tcg_constant_i32(4), v7m.ltpsize);
      }
      /* End TB, continuing to following insn */
      gen_jmp_tb(s, s->base.pc_next, 1);
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 28/45] target/arm: Use gvec for NEON VMOV, VMVN, VBIC & VORR (immediate)
+[PULL 34/54] target/arm: Use tcg_constant in trans_CPS_v7m
 From: Richard Henderson <richard.henderson@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-8-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-35-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 67 ++++++++++++++++++++++++------------------
+ target/arm/translate.c | 9 +++------
-file changed, 39 insertions(+), 28 deletions(-)
+file changed, 3 insertions(+), 6 deletions(-)
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static bool trans_CPS_v7m(DisasContext *s, arg_CPS_v7m *a)
-                 return 1;
+         return true;
-             }
+     }
-         } else { /* (insn & 0x00380080) == 0 */
--            int invert;
+-    tmp = tcg_const_i32(a->im);
-+            int invert, reg_ofs, vec_size;
++    tmp = tcg_constant_i32(a->im);
-+
+     /* FAULTMASK */
-             if (q && (rd & 1)) {
+     if (a->F) {
-                 return 1;
+-        addr = tcg_const_i32(19);
-             }
++        addr = tcg_constant_i32(19);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+         gen_helper_v7m_msr(cpu_env, addr, tmp);
-                 break;
+-        tcg_temp_free_i32(addr);
-             case 14:
+     }
-                 imm |= (imm << 8) | (imm << 16) | (imm << 24);
+     /* PRIMASK */
--                if (invert)
+     if (a->I) {
-+                if (invert) {
+-        addr = tcg_const_i32(16);
-                     imm = ~imm;
++        addr = tcg_constant_i32(16);
-+                }
+         gen_helper_v7m_msr(cpu_env, addr, tmp);
-                 break;
+-        tcg_temp_free_i32(addr);
-             case 15:
+     }
-                 if (invert) {
+     gen_rebuild_hflags(s, false);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+-    tcg_temp_free_i32(tmp);
-                       | ((imm & 0x40) ? (0x1f << 25) : (1 << 30));
+     gen_lookup_tb(s);
-                 break;
+     return true;
-             }
+ }
 -            if (invert)
 +            if (invert) {
                  imm = ~imm;
 +            }
 -            for (pass = 0; pass < (q ? 4 : 2); pass++) {
 -                if (op & 1 && op < 12) {
 -                    tmp = neon_load_reg(rd, pass);
 -                    if (invert) {
 -                        /* The immediate value has already been inverted, so
 -                           BIC becomes AND.  */
 -                        tcg_gen_andi_i32(tmp, tmp, imm);
 -                    } else {
 -                        tcg_gen_ori_i32(tmp, tmp, imm);
 -                    }
 +            reg_ofs = neon_reg_offset(rd, 0);
 +            vec_size = q ? 16 : 8;
 +
 +            if (op & 1 && op < 12) {
 +                if (invert) {
 +                    /* The immediate value has already been inverted,
 +                     * so BIC becomes AND.
 +                     */
 +                    tcg_gen_gvec_andi(MO_32, reg_ofs, reg_ofs, imm,
 +                                      vec_size, vec_size);
                  } else {
 -                    /* VMOV, VMVN.  */
 -                    tmp = tcg_temp_new_i32();
 -                    if (op == 14 && invert) {
 -                        int n;
 -                        uint32_t val;
 -                        val = 0;
 -                        for (n = 0; n < 4; n++) {
 -                            if (imm & (1 << (n + (pass & 1) * 4)))
 -                                val |= 0xff << (n * 8);
 -                        }
 -                        tcg_gen_movi_i32(tmp, val);
 -                    } else {
 -                        tcg_gen_movi_i32(tmp, imm);
 -                    }
 +                    tcg_gen_gvec_ori(MO_32, reg_ofs, reg_ofs, imm,
 +                                     vec_size, vec_size);
 +                }
 +            } else {
 +                /* VMOV, VMVN.  */
 +                if (op == 14 && invert) {
 +                    TCGv_i64 t64 = tcg_temp_new_i64();
 +
 +                    for (pass = 0; pass <= q; ++pass) {
 +                        uint64_t val = 0;
 +                        int n;
 +
 +                        for (n = 0; n < 8; n++) {
 +                            if (imm & (1 << (n + pass * 8))) {
 +                                val |= 0xffull << (n * 8);
 +                            }
 +                        }
 +                        tcg_gen_movi_i64(t64, val);
 +                        neon_store_reg64(t64, rd + pass);
 +                    }
 +                    tcg_temp_free_i64(t64);
 +                } else {
 +                    tcg_gen_gvec_dup32i(reg_ofs, vec_size, vec_size, imm);
                  }
 -                neon_store_reg(rd, pass, tmp);
              }
          }
      } else { /* (insn & 0x00800010 == 0x00800000) */
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 26/45] target/arm: Mark some arrays const
+[PULL 35/54] target/arm: Use tcg_constant in trans_CSEL
 From: Richard Henderson <richard.henderson@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
-Message-id: 20181011205206.3552-6-richard.henderson@linaro.org
-[PMM: drop change to now-deleted cpu_mode_names array]
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-36-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 4 ++--
+ target/arm/translate.c | 7 +++----
-file changed, 2 insertions(+), 2 deletions(-)
+file changed, 3 insertions(+), 4 deletions(-)
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static TCGv_i64 cpu_F0d, cpu_F1d;
+@@ -XXX,XX +XXX,XX @@ static bool trans_CSEL(DisasContext *s, arg_CSEL *a)
+     }
- #include "exec/gen-icount.h"
+     /* In this insn input reg fields of 0b1111 mean "zero", not "PC" */
--static const char *regnames[] =
++    zero = tcg_constant_i32(0);
-+static const char * const regnames[] =
+     if (a->rn == 15) {
-     { "r0", "r1", "r2", "r3", "r4", "r5", "r6", "r7",
+-        rn = tcg_const_i32(0);
-       "r8", "r9", "r10", "r11", "r12", "r13", "r14", "pc" };
++        rn = zero;
+     } else {
-@@ -XXX,XX +XXX,XX @@ static struct {
+         rn = load_reg(s, a->rn);
-     int nregs;
+     }
-     int interleave;
+     if (a->rm == 15) {
-     int spacing;
+-        rm = tcg_const_i32(0);
--} neon_ls_element_type[11] = {
++        rm = zero;
-+} const neon_ls_element_type[11] = {
+     } else {
-     {4, 4, 1},
+         rm = load_reg(s, a->rm);
-     {4, 4, 2},
+     }
-     {4, 1, 1},
+@@ -XXX,XX +XXX,XX @@ static bool trans_CSEL(DisasContext *s, arg_CSEL *a)
      }
      arm_test_cc(&c, a->fcond);
 -    zero = tcg_const_i32(0);
      tcg_gen_movcond_i32(c.cond, rn, c.value, zero, rn, rm);
      arm_free_cc(&c);
 -    tcg_temp_free_i32(zero);
      store_reg(s, a->rd, rn);
      tcg_temp_free_i32(rm);
 --
-.19.1
+.25.1

-New patch
+[PULL 36/54] target/arm: Use tcg_constant for trans_INDEX_*
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-37-richard.henderson@linaro.org
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 12 ++++--------
+file changed, 4 insertions(+), 8 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static void do_index(DisasContext *s, int esz, int rd,
+ static bool trans_INDEX_ii(DisasContext *s, arg_INDEX_ii *a)
+ {
+     if (sve_access_check(s)) {
+-        TCGv_i64 start = tcg_const_i64(a->imm1);
+-        TCGv_i64 incr = tcg_const_i64(a->imm2);
++        TCGv_i64 start = tcg_constant_i64(a->imm1);
++        TCGv_i64 incr = tcg_constant_i64(a->imm2);
+         do_index(s, a->esz, a->rd, start, incr);
+-        tcg_temp_free_i64(start);
+-        tcg_temp_free_i64(incr);
+     }
+     return true;
+ }
+@@ -XXX,XX +XXX,XX @@ static bool trans_INDEX_ii(DisasContext *s, arg_INDEX_ii *a)
+ static bool trans_INDEX_ir(DisasContext *s, arg_INDEX_ir *a)
+ {
+     if (sve_access_check(s)) {
+-        TCGv_i64 start = tcg_const_i64(a->imm);
++        TCGv_i64 start = tcg_constant_i64(a->imm);
+         TCGv_i64 incr = cpu_reg(s, a->rm);
+         do_index(s, a->esz, a->rd, start, incr);
+-        tcg_temp_free_i64(start);
+     }
+     return true;
+ }
+@@ -XXX,XX +XXX,XX @@ static bool trans_INDEX_ri(DisasContext *s, arg_INDEX_ri *a)
+ {
+     if (sve_access_check(s)) {
+         TCGv_i64 start = cpu_reg(s, a->rn);
+-        TCGv_i64 incr = tcg_const_i64(a->imm);
++        TCGv_i64 incr = tcg_constant_i64(a->imm);
+         do_index(s, a->esz, a->rd, start, incr);
+-        tcg_temp_free_i64(incr);
+     }
+     return true;
+ }
+--
+.25.1

-New patch
+[PULL 37/54] target/arm: Use tcg_constant in SINCDEC, INCDEC
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-38-richard.henderson@linaro.org
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 18 ++++++------------
+file changed, 6 insertions(+), 12 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool trans_SINCDEC_r_32(DisasContext *s, arg_incdec_cnt *a)
+             tcg_gen_ext32s_i64(reg, reg);
+         }
+     } else {
+-        TCGv_i64 t = tcg_const_i64(inc);
+-        do_sat_addsub_32(reg, t, a->u, a->d);
+-        tcg_temp_free_i64(t);
++        do_sat_addsub_32(reg, tcg_constant_i64(inc), a->u, a->d);
+     }
+     return true;
+ }
+@@ -XXX,XX +XXX,XX @@ static bool trans_SINCDEC_r_64(DisasContext *s, arg_incdec_cnt *a)
+     TCGv_i64 reg = cpu_reg(s, a->rd);
+     if (inc != 0) {
+-        TCGv_i64 t = tcg_const_i64(inc);
+-        do_sat_addsub_64(reg, t, a->u, a->d);
+-        tcg_temp_free_i64(t);
++        do_sat_addsub_64(reg, tcg_constant_i64(inc), a->u, a->d);
+     }
+     return true;
+ }
+@@ -XXX,XX +XXX,XX @@ static bool trans_INCDEC_v(DisasContext *s, arg_incdec2_cnt *a)
+     if (inc != 0) {
+         if (sve_access_check(s)) {
+-            TCGv_i64 t = tcg_const_i64(a->d ? -inc : inc);
+             tcg_gen_gvec_adds(a->esz, vec_full_reg_offset(s, a->rd),
+                               vec_full_reg_offset(s, a->rn),
+-                              t, fullsz, fullsz);
+-            tcg_temp_free_i64(t);
++                              tcg_constant_i64(a->d ? -inc : inc),
++                              fullsz, fullsz);
+         }
+     } else {
+         do_mov_z(s, a->rd, a->rn);
+@@ -XXX,XX +XXX,XX @@ static bool trans_SINCDEC_v(DisasContext *s, arg_incdec2_cnt *a)
+     if (inc != 0) {
+         if (sve_access_check(s)) {
+-            TCGv_i64 t = tcg_const_i64(inc);
+-            do_sat_addsub_vec(s, a->esz, a->rd, a->rn, t, a->u, a->d);
+-            tcg_temp_free_i64(t);
++            do_sat_addsub_vec(s, a->esz, a->rd, a->rn,
++                              tcg_constant_i64(inc), a->u, a->d);
+         }
+     } else {
+         do_mov_z(s, a->rd, a->rn);
+--
+.25.1

-New patch
+[PULL 38/54] target/arm: Use tcg_constant in FCPY, CPY
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-39-richard.henderson@linaro.org
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 13 ++++---------
+file changed, 4 insertions(+), 9 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool trans_FCPY(DisasContext *s, arg_FCPY *a)
+     if (sve_access_check(s)) {
+         /* Decode the VFP immediate.  */
+         uint64_t imm = vfp_expand_imm(a->esz, a->imm);
+-        TCGv_i64 t_imm = tcg_const_i64(imm);
+-        do_cpy_m(s, a->esz, a->rd, a->rn, a->pg, t_imm);
+-        tcg_temp_free_i64(t_imm);
++        do_cpy_m(s, a->esz, a->rd, a->rn, a->pg, tcg_constant_i64(imm));
+     }
+     return true;
+ }
+@@ -XXX,XX +XXX,XX @@ static bool trans_CPY_m_i(DisasContext *s, arg_rpri_esz *a)
+         return false;
+     }
+     if (sve_access_check(s)) {
+-        TCGv_i64 t_imm = tcg_const_i64(a->imm);
+-        do_cpy_m(s, a->esz, a->rd, a->rn, a->pg, t_imm);
+-        tcg_temp_free_i64(t_imm);
++        do_cpy_m(s, a->esz, a->rd, a->rn, a->pg, tcg_constant_i64(a->imm));
+     }
+     return true;
+ }
+@@ -XXX,XX +XXX,XX @@ static bool trans_CPY_z_i(DisasContext *s, arg_CPY_z_i *a)
+     }
+     if (sve_access_check(s)) {
+         unsigned vsz = vec_full_reg_size(s);
+-        TCGv_i64 t_imm = tcg_const_i64(a->imm);
+         tcg_gen_gvec_2i_ool(vec_full_reg_offset(s, a->rd),
+                             pred_full_reg_offset(s, a->pg),
+-                            t_imm, vsz, vsz, 0, fns[a->esz]);
+-        tcg_temp_free_i64(t_imm);
++                            tcg_constant_i64(a->imm),
++                            vsz, vsz, 0, fns[a->esz]);
+     }
+     return true;
+ }
+--
+.25.1

-[Qemu-devel] [PULL 13/45] target/arm: Implement HCR.FB
+[PULL 39/54] target/arm: Use tcg_constant in {incr, wrap}_last_active
-The HCR.FB virtualization configuration register bit requests that
+From: Richard Henderson <richard.henderson@linaro.org>
 TLB maintenance, branch predictor invalidate-all and icache
 invalidate-all operations performed in NS EL1 should be upgraded
 from "local CPU only to "broadcast within Inner Shareable domain".
 For QEMU we NOP the branch predictor and icache operations, so
 we only need to upgrade the TLB invalidates:
  AArch32 TLBIALL, TLBIMVA, TLBIASID, DTLBIALL, DTLBIMVA, DTLBIASID,
          ITLBIALL, ITLBIMVA, ITLBIASID, TLBIMVAA, TLBIMVAL, TLBIMVAAL
  AArch64 TLBI VMALLE1, TLBI VAE1, TLBI ASIDE1, TLBI VAAE1,
          TLBI VALE1, TLBI VAALE1
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-40-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181012144235.19646-4-peter.maydell@linaro.org
 ---
- target/arm/helper.c | 191 +++++++++++++++++++++++++++-----------------
+ target/arm/translate-sve.c | 12 ++++--------
-file changed, 116 insertions(+), 75 deletions(-)
+file changed, 4 insertions(+), 8 deletions(-)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/helper.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static void contextidr_write(CPUARMState *env, const ARMCPRegInfo *ri,
+@@ -XXX,XX +XXX,XX @@ static void incr_last_active(DisasContext *s, TCGv_i32 last, int esz)
-     raw_write(env, ri, value);
+     if (is_power_of_2(vsz)) {
- }
+         tcg_gen_andi_i32(last, last, vsz - 1);
+     } else {
--static void tlbiall_write(CPUARMState *env, const ARMCPRegInfo *ri,
+-        TCGv_i32 max = tcg_const_i32(vsz);
--                          uint64_t value)
+-        TCGv_i32 zero = tcg_const_i32(0);
--{
++        TCGv_i32 max = tcg_constant_i32(vsz);
--    /* Invalidate all (TLBIALL) */
++        TCGv_i32 zero = tcg_constant_i32(0);
--    ARMCPU *cpu = arm_env_get_cpu(env);
+         tcg_gen_movcond_i32(TCG_COND_GEU, last, last, max, zero, last);
--
+-        tcg_temp_free_i32(max);
--    tlb_flush(CPU(cpu));
+-        tcg_temp_free_i32(zero);
 -}
 -
 -static void tlbimva_write(CPUARMState *env, const ARMCPRegInfo *ri,
 -                          uint64_t value)
 -{
 -    /* Invalidate single TLB entry by MVA and ASID (TLBIMVA) */
 -    ARMCPU *cpu = arm_env_get_cpu(env);
 -
 -    tlb_flush_page(CPU(cpu), value & TARGET_PAGE_MASK);
 -}
 -
 -static void tlbiasid_write(CPUARMState *env, const ARMCPRegInfo *ri,
 -                           uint64_t value)
 -{
 -    /* Invalidate by ASID (TLBIASID) */
 -    ARMCPU *cpu = arm_env_get_cpu(env);
 -
 -    tlb_flush(CPU(cpu));
 -}
 -
 -static void tlbimvaa_write(CPUARMState *env, const ARMCPRegInfo *ri,
 -                           uint64_t value)
 -{
 -    /* Invalidate single entry by MVA, all ASIDs (TLBIMVAA) */
 -    ARMCPU *cpu = arm_env_get_cpu(env);
 -
 -    tlb_flush_page(CPU(cpu), value & TARGET_PAGE_MASK);
 -}
 -
  /* IS variants of TLB operations must affect all cores */
  static void tlbiall_is_write(CPUARMState *env, const ARMCPRegInfo *ri,
                               uint64_t value)
@@ -XXX,XX +XXX,XX @@ static void tlbimvaa_is_write(CPUARMState *env, const ARMCPRegInfo *ri,
      tlb_flush_page_all_cpus_synced(cs, value & TARGET_PAGE_MASK);
  }
 +/*
 + * Non-IS variants of TLB operations are upgraded to
 + * IS versions if we are at NS EL1 and HCR_EL2.FB is set to
 + * force broadcast of these operations.
 + */
 +static bool tlb_force_broadcast(CPUARMState *env)
 +{
 +    return (env->cp15.hcr_el2 & HCR_FB) &&
 +        arm_current_el(env) == 1 && arm_is_secure_below_el3(env);
 +}
 +
 +static void tlbiall_write(CPUARMState *env, const ARMCPRegInfo *ri,
 +                          uint64_t value)
 +{
 +    /* Invalidate all (TLBIALL) */
 +    ARMCPU *cpu = arm_env_get_cpu(env);
 +
 +    if (tlb_force_broadcast(env)) {
 +        tlbiall_is_write(env, NULL, value);
 +        return;
 +    }
 +
 +    tlb_flush(CPU(cpu));
 +}
 +
 +static void tlbimva_write(CPUARMState *env, const ARMCPRegInfo *ri,
 +                          uint64_t value)
 +{
 +    /* Invalidate single TLB entry by MVA and ASID (TLBIMVA) */
 +    ARMCPU *cpu = arm_env_get_cpu(env);
 +
 +    if (tlb_force_broadcast(env)) {
 +        tlbimva_is_write(env, NULL, value);
 +        return;
 +    }
 +
 +    tlb_flush_page(CPU(cpu), value & TARGET_PAGE_MASK);
 +}
 +
 +static void tlbiasid_write(CPUARMState *env, const ARMCPRegInfo *ri,
 +                           uint64_t value)
 +{
 +    /* Invalidate by ASID (TLBIASID) */
 +    ARMCPU *cpu = arm_env_get_cpu(env);
 +
 +    if (tlb_force_broadcast(env)) {
 +        tlbiasid_is_write(env, NULL, value);
 +        return;
 +    }
 +
 +    tlb_flush(CPU(cpu));
 +}
 +
 +static void tlbimvaa_write(CPUARMState *env, const ARMCPRegInfo *ri,
 +                           uint64_t value)
 +{
 +    /* Invalidate single entry by MVA, all ASIDs (TLBIMVAA) */
 +    ARMCPU *cpu = arm_env_get_cpu(env);
 +
 +    if (tlb_force_broadcast(env)) {
 +        tlbimvaa_is_write(env, NULL, value);
 +        return;
 +    }
 +
 +    tlb_flush_page(CPU(cpu), value & TARGET_PAGE_MASK);
 +}
 +
  static void tlbiall_nsnh_write(CPUARMState *env, const ARMCPRegInfo *ri,
                                 uint64_t value)
  {
@@ -XXX,XX +XXX,XX @@ static CPAccessResult aa64_cacheop_access(CPUARMState *env,
   * Page D4-1736 (DDI0487A.b)
   */
 -static void tlbi_aa64_vmalle1_write(CPUARMState *env, const ARMCPRegInfo *ri,
 -                                    uint64_t value)
 -{
 -    CPUState *cs = ENV_GET_CPU(env);
 -
 -    if (arm_is_secure_below_el3(env)) {
 -        tlb_flush_by_mmuidx(cs,
 -                            ARMMMUIdxBit_S1SE1 |
 -                            ARMMMUIdxBit_S1SE0);
 -    } else {
 -        tlb_flush_by_mmuidx(cs,
 -                            ARMMMUIdxBit_S12NSE1 |
 -                            ARMMMUIdxBit_S12NSE0);
 -    }
 -}
 -
  static void tlbi_aa64_vmalle1is_write(CPUARMState *env, const ARMCPRegInfo *ri,
                                        uint64_t value)
  {
@@ -XXX,XX +XXX,XX @@ static void tlbi_aa64_vmalle1is_write(CPUARMState *env, const ARMCPRegInfo *ri,
      }
  }
-+static void tlbi_aa64_vmalle1_write(CPUARMState *env, const ARMCPRegInfo *ri,
+@@ -XXX,XX +XXX,XX @@ static void wrap_last_active(DisasContext *s, TCGv_i32 last, int esz)
-+                                    uint64_t value)
+     if (is_power_of_2(vsz)) {
-+{
+         tcg_gen_andi_i32(last, last, vsz - 1);
-+    CPUState *cs = ENV_GET_CPU(env);
+     } else {
-+
+-        TCGv_i32 max = tcg_const_i32(vsz - (1 << esz));
-+    if (tlb_force_broadcast(env)) {
+-        TCGv_i32 zero = tcg_const_i32(0);
-+        tlbi_aa64_vmalle1_write(env, NULL, value);
++        TCGv_i32 max = tcg_constant_i32(vsz - (1 << esz));
-+        return;
++        TCGv_i32 zero = tcg_constant_i32(0);
-+    }
+         tcg_gen_movcond_i32(TCG_COND_LT, last, last, zero, max, last);
-+
+-        tcg_temp_free_i32(max);
-+    if (arm_is_secure_below_el3(env)) {
+-        tcg_temp_free_i32(zero);
 +        tlb_flush_by_mmuidx(cs,
 +                            ARMMMUIdxBit_S1SE1 |
 +                            ARMMMUIdxBit_S1SE0);
 +    } else {
 +        tlb_flush_by_mmuidx(cs,
 +                            ARMMMUIdxBit_S12NSE1 |
 +                            ARMMMUIdxBit_S12NSE0);
 +    }
 +}
 +
  static void tlbi_aa64_alle1_write(CPUARMState *env, const ARMCPRegInfo *ri,
                                    uint64_t value)
  {
@@ -XXX,XX +XXX,XX @@ static void tlbi_aa64_alle3is_write(CPUARMState *env, const ARMCPRegInfo *ri,
      tlb_flush_by_mmuidx_all_cpus_synced(cs, ARMMMUIdxBit_S1E3);
  }
 -static void tlbi_aa64_vae1_write(CPUARMState *env, const ARMCPRegInfo *ri,
 -                                 uint64_t value)
 -{
 -    /* Invalidate by VA, EL1&0 (AArch64 version).
 -     * Currently handles all of VAE1, VAAE1, VAALE1 and VALE1,
 -     * since we don't support flush-for-specific-ASID-only or
 -     * flush-last-level-only.
 -     */
 -    ARMCPU *cpu = arm_env_get_cpu(env);
 -    CPUState *cs = CPU(cpu);
 -    uint64_t pageaddr = sextract64(value << 12, 0, 56);
 -
 -    if (arm_is_secure_below_el3(env)) {
 -        tlb_flush_page_by_mmuidx(cs, pageaddr,
 -                                 ARMMMUIdxBit_S1SE1 |
 -                                 ARMMMUIdxBit_S1SE0);
 -    } else {
 -        tlb_flush_page_by_mmuidx(cs, pageaddr,
 -                                 ARMMMUIdxBit_S12NSE1 |
 -                                 ARMMMUIdxBit_S12NSE0);
 -    }
 -}
 -
  static void tlbi_aa64_vae2_write(CPUARMState *env, const ARMCPRegInfo *ri,
                                   uint64_t value)
  {
@@ -XXX,XX +XXX,XX @@ static void tlbi_aa64_vae1is_write(CPUARMState *env, const ARMCPRegInfo *ri,
      }
  }
-+static void tlbi_aa64_vae1_write(CPUARMState *env, const ARMCPRegInfo *ri,
-+                                 uint64_t value)
-+{
-+    /* Invalidate by VA, EL1&0 (AArch64 version).
-+     * Currently handles all of VAE1, VAAE1, VAALE1 and VALE1,
-+     * since we don't support flush-for-specific-ASID-only or
-+     * flush-last-level-only.
-+     */
-+    ARMCPU *cpu = arm_env_get_cpu(env);
-+    CPUState *cs = CPU(cpu);
-+    uint64_t pageaddr = sextract64(value << 12, 0, 56);
-+
-+    if (tlb_force_broadcast(env)) {
-+        tlbi_aa64_vae1is_write(env, NULL, value);
-+        return;
-+    }
-+
-+    if (arm_is_secure_below_el3(env)) {
-+        tlb_flush_page_by_mmuidx(cs, pageaddr,
-+                                 ARMMMUIdxBit_S1SE1 |
-+                                 ARMMMUIdxBit_S1SE0);
-+    } else {
-+        tlb_flush_page_by_mmuidx(cs, pageaddr,
-+                                 ARMMMUIdxBit_S12NSE1 |
-+                                 ARMMMUIdxBit_S12NSE0);
-+    }
-+}
-+
- static void tlbi_aa64_vae2is_write(CPUARMState *env, const ARMCPRegInfo *ri,
-                                    uint64_t value)
- {
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 45/45] target/arm: Only flush tlb if ASID changes
+[PULL 40/54] target/arm: Use tcg_constant in do_clast_scalar
 From: Richard Henderson <richard.henderson@linaro.org>
-Since QEMU does not implement ASIDs, changes to the ASID must flush the
-tlb.  However, if the ASID does not change there is no reason to flush.
-In testing a boot of the Ubuntu installer to the first menu, this reduces
-the number of flushes by 30%, or nearly 600k instances.
-Reviewed-by: Aaron Lindsay <aaron@os.amperecomputing.com>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
+Message-id: 20220426163043.100432-41-richard.henderson@linaro.org
 Message-id: 20181019015617.22583-3-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper.c | 8 +++-----
+ target/arm/translate-sve.c | 7 +++----
-file changed, 3 insertions(+), 5 deletions(-)
+file changed, 3 insertions(+), 4 deletions(-)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/helper.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static void vmsa_tcr_el1_write(CPUARMState *env, const ARMCPRegInfo *ri,
+@@ -XXX,XX +XXX,XX @@ static void do_clast_scalar(DisasContext *s, int esz, int pg, int rm,
- static void vmsa_ttbr_write(CPUARMState *env, const ARMCPRegInfo *ri,
+                             bool before, TCGv_i64 reg_val)
                              uint64_t value)
  {
--    /* 64 bit accesses to the TTBRs can change the ASID and so we
+     TCGv_i32 last = tcg_temp_new_i32();
--     * must flush the TLB.
+-    TCGv_i64 ele, cmp, zero;
--     */
++    TCGv_i64 ele, cmp;
--    if (cpreg_field_is_64bit(ri)) {
-+    /* If the ASID changes (with a 64-bit write), we must flush the TLB.  */
+     find_last_active(s, last, esz, pg);
-+    if (cpreg_field_is_64bit(ri) &&
-+        extract64(raw_read(env, ri) ^ value, 48, 16) != 0) {
+@@ -XXX,XX +XXX,XX @@ static void do_clast_scalar(DisasContext *s, int esz, int pg, int rm,
-         ARMCPU *cpu = arm_env_get_cpu(env);
+     ele = load_last_active(s, last, rm, esz);
--
+     tcg_temp_free_i32(last);
-         tlb_flush(CPU(cpu));
-     }
+-    zero = tcg_const_i64(0);
-     raw_write(env, ri, value);
+-    tcg_gen_movcond_i64(TCG_COND_GE, reg_val, cmp, zero, ele, reg_val);
 +    tcg_gen_movcond_i64(TCG_COND_GE, reg_val, cmp, tcg_constant_i64(0),
 +                        ele, reg_val);
 -    tcg_temp_free_i64(zero);
      tcg_temp_free_i64(cmp);
      tcg_temp_free_i64(ele);
  }
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 14/45] target/arm: Implement HCR.DC
+[PULL 41/54] target/arm: Use tcg_constant in WHILE
-The HCR.DC virtualization configuration register bit has the
+From: Richard Henderson <richard.henderson@linaro.org>
 following effects:
  * SCTLR.M behaves as if it is 0 for all purposes except
    direct reads of the bit
  * HCR.VM behaves as if it is 1 for all purposes except
    direct reads of the bit
  * the memory type produced by the first stage of the EL1&EL0
    translation regime is Normal Non-Shareable,
    Inner Write-Back Read-Allocate Write-Allocate,
    Outer Write-Back Read-Allocate Write-Allocate.
-Implement this behaviour.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Message-id: 20220426163043.100432-42-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/translate-sve.c | 20 +++++++-------------
 file changed, 7 insertions(+), 13 deletions(-)
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20181012144235.19646-5-peter.maydell@linaro.org
 ---
  target/arm/helper.c | 23 +++++++++++++++++++++--
 file changed, 21 insertions(+), 2 deletions(-)
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/helper.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static uint64_t do_ats_write(CPUARMState *env, uint64_t value,
+@@ -XXX,XX +XXX,XX @@ static bool trans_CTERM(DisasContext *s, arg_CTERM *a)
-          * * The Non-secure TTBCR.EAE bit is set to 1
+ static bool trans_WHILE(DisasContext *s, arg_WHILE *a)
-          * * The implementation includes EL2, and the value of HCR.VM is 1
+ {
-          *
+     TCGv_i64 op0, op1, t0, t1, tmax;
-+         * (Note that HCR.DC makes HCR.VM behave as if it is 1.)
+-    TCGv_i32 t2, t3;
-+         *
++    TCGv_i32 t2;
-          * ATS1Hx always uses the 64bit format (not supported yet).
+     TCGv_ptr ptr;
-          */
+     unsigned vsz = vec_full_reg_size(s);
-         format64 = arm_s1_regime_using_lpae_format(env, mmu_idx);
+     unsigned desc = 0;
+@@ -XXX,XX +XXX,XX @@ static bool trans_WHILE(DisasContext *s, arg_WHILE *a)
          if (arm_feature(env, ARM_FEATURE_EL2)) {
              if (mmu_idx == ARMMMUIdx_S12NSE0 || mmu_idx == ARMMMUIdx_S12NSE1) {
 -                format64 |= env->cp15.hcr_el2 & HCR_VM;
 +                format64 |= env->cp15.hcr_el2 & (HCR_VM | HCR_DC);
              } else {
                  format64 |= arm_current_el(env) == 2;
              }
@@ -XXX,XX +XXX,XX @@ static inline bool regime_translation_disabled(CPUARMState *env,
      }
      if (mmu_idx == ARMMMUIdx_S2NS) {
 -        return (env->cp15.hcr_el2 & HCR_VM) == 0;
 +        /* HCR.DC means HCR.VM behaves as 1 */
 +        return (env->cp15.hcr_el2 & (HCR_DC | HCR_VM)) == 0;
      }
      if (env->cp15.hcr_el2 & HCR_TGE) {
@@ -XXX,XX +XXX,XX @@ static inline bool regime_translation_disabled(CPUARMState *env,
          }
      }
-+    if ((env->cp15.hcr_el2 & HCR_DC) &&
+-    tmax = tcg_const_i64(vsz >> a->esz);
-+        (mmu_idx == ARMMMUIdx_S1NSE0 || mmu_idx == ARMMMUIdx_S1NSE1)) {
++    tmax = tcg_constant_i64(vsz >> a->esz);
-+        /* HCR.DC means SCTLR_EL1.M behaves as 0 */
+     if (eq) {
-+        return true;
+         /* Equality means one more iteration.  */
-+    }
+         tcg_gen_addi_i64(t0, t0, 1);
-+
+@@ -XXX,XX +XXX,XX @@ static bool trans_WHILE(DisasContext *s, arg_WHILE *a)
-     return (regime_sctlr(env, mmu_idx) & SCTLR_M) == 0;
      /* Bound to the maximum.  */
      tcg_gen_umin_i64(t0, t0, tmax);
 -    tcg_temp_free_i64(tmax);
      /* Set the count to zero if the condition is false.  */
      tcg_gen_movi_i64(t1, 0);
@@ -XXX,XX +XXX,XX @@ static bool trans_WHILE(DisasContext *s, arg_WHILE *a)
      desc = FIELD_DP32(desc, PREDDESC, OPRSZ, vsz / 8);
      desc = FIELD_DP32(desc, PREDDESC, ESZ, a->esz);
 -    t3 = tcg_const_i32(desc);
      ptr = tcg_temp_new_ptr();
      tcg_gen_addi_ptr(ptr, cpu_env, pred_full_reg_offset(s, a->rd));
      if (a->lt) {
 -        gen_helper_sve_whilel(t2, ptr, t2, t3);
 +        gen_helper_sve_whilel(t2, ptr, t2, tcg_constant_i32(desc));
      } else {
 -        gen_helper_sve_whileg(t2, ptr, t2, t3);
 +        gen_helper_sve_whileg(t2, ptr, t2, tcg_constant_i32(desc));
      }
      do_pred_flags(t2);
      tcg_temp_free_ptr(ptr);
      tcg_temp_free_i32(t2);
 -    tcg_temp_free_i32(t3);
      return true;
  }
-@@ -XXX,XX +XXX,XX @@ static bool get_phys_addr(CPUARMState *env, target_ulong address,
+ static bool trans_WHILE_ptr(DisasContext *s, arg_WHILE_ptr *a)
+ {
-             /* Combine the S1 and S2 cache attributes, if needed */
+     TCGv_i64 op0, op1, diff, t1, tmax;
-             if (!ret && cacheattrs != NULL) {
+-    TCGv_i32 t2, t3;
-+                if (env->cp15.hcr_el2 & HCR_DC) {
++    TCGv_i32 t2;
-+                    /*
+     TCGv_ptr ptr;
-+                     * HCR.DC forces the first stage attributes to
+     unsigned vsz = vec_full_reg_size(s);
-+                     *  Normal Non-Shareable,
+     unsigned desc = 0;
-+                     *  Inner Write-Back Read-Allocate Write-Allocate,
+@@ -XXX,XX +XXX,XX @@ static bool trans_WHILE_ptr(DisasContext *s, arg_WHILE_ptr *a)
-+                     *  Outer Write-Back Read-Allocate Write-Allocate.
+     op0 = read_cpu_reg(s, a->rn, 1);
-+                     */
+     op1 = read_cpu_reg(s, a->rm, 1);
-+                    cacheattrs->attrs = 0xff;
-+                    cacheattrs->shareability = 0;
+-    tmax = tcg_const_i64(vsz);
-+                }
++    tmax = tcg_constant_i64(vsz);
-                 *cacheattrs = combine_cacheattrs(*cacheattrs, cacheattrs2);
+     diff = tcg_temp_new_i64();
-             }
      if (a->rw) {
@@ -XXX,XX +XXX,XX @@ static bool trans_WHILE_ptr(DisasContext *s, arg_WHILE_ptr *a)
      /* Bound to the maximum.  */
      tcg_gen_umin_i64(diff, diff, tmax);
 -    tcg_temp_free_i64(tmax);
      /* Since we're bounded, pass as a 32-bit type.  */
      t2 = tcg_temp_new_i32();
@@ -XXX,XX +XXX,XX @@ static bool trans_WHILE_ptr(DisasContext *s, arg_WHILE_ptr *a)
      desc = FIELD_DP32(desc, PREDDESC, OPRSZ, vsz / 8);
      desc = FIELD_DP32(desc, PREDDESC, ESZ, a->esz);
 -    t3 = tcg_const_i32(desc);
      ptr = tcg_temp_new_ptr();
      tcg_gen_addi_ptr(ptr, cpu_env, pred_full_reg_offset(s, a->rd));
 -    gen_helper_sve_whilel(t2, ptr, t2, t3);
 +    gen_helper_sve_whilel(t2, ptr, t2, tcg_constant_i32(desc));
      do_pred_flags(t2);
      tcg_temp_free_ptr(ptr);
      tcg_temp_free_i32(t2);
 -    tcg_temp_free_i32(t3);
      return true;
  }
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 12/45] target/arm: Make switch_mode() file-local
+[PULL 42/54] target/arm: Use tcg_constant in LD1, ST1
-The switch_mode() function is defined in target/arm/helper.c and used
+From: Richard Henderson <richard.henderson@linaro.org>
 only in that file and nowhere else, so we can make it file-local
 rather than global.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-43-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181012144235.19646-3-peter.maydell@linaro.org
 ---
- target/arm/internals.h | 1 -
+ target/arm/translate-sve.c | 12 ++++--------
- target/arm/helper.c    | 6 ++++--
+file changed, 4 insertions(+), 8 deletions(-)
 files changed, 4 insertions(+), 3 deletions(-)
-diff --git a/target/arm/internals.h b/target/arm/internals.h
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/internals.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/internals.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static inline int bank_number(int mode)
+@@ -XXX,XX +XXX,XX @@ static bool trans_LD1_zpiz(DisasContext *s, arg_LD1_zpiz *a)
-     g_assert_not_reached();
+     gen_helper_gvec_mem_scatter *fn = NULL;
      bool be = s->be_data == MO_BE;
      bool mte = s->mte_active[0];
 -    TCGv_i64 imm;
      if (a->esz < a->msz || (a->esz == a->msz && !a->u)) {
          return false;
@@ -XXX,XX +XXX,XX @@ static bool trans_LD1_zpiz(DisasContext *s, arg_LD1_zpiz *a)
      /* Treat LD1_zpiz (zn[x] + imm) the same way as LD1_zprz (rn + zm[x])
       * by loading the immediate into the scalar parameter.
       */
 -    imm = tcg_const_i64(a->imm << a->msz);
 -    do_mem_zpz(s, a->rd, a->pg, a->rn, 0, imm, a->msz, false, fn);
 -    tcg_temp_free_i64(imm);
 +    do_mem_zpz(s, a->rd, a->pg, a->rn, 0,
 +               tcg_constant_i64(a->imm << a->msz), a->msz, false, fn);
      return true;
  }
--void switch_mode(CPUARMState *, int);
+@@ -XXX,XX +XXX,XX @@ static bool trans_ST1_zpiz(DisasContext *s, arg_ST1_zpiz *a)
- void arm_cpu_register_gdb_regs_for_features(ARMCPU *cpu);
+     gen_helper_gvec_mem_scatter *fn = NULL;
- void arm_translate_init(void);
+     bool be = s->be_data == MO_BE;
+     bool mte = s->mte_active[0];
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+-    TCGv_i64 imm;
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+     if (a->esz < a->msz) {
-+++ b/target/arm/helper.c
+         return false;
-@@ -XXX,XX +XXX,XX @@ static void v8m_security_lookup(CPUARMState *env, uint32_t address,
+@@ -XXX,XX +XXX,XX @@ static bool trans_ST1_zpiz(DisasContext *s, arg_ST1_zpiz *a)
-                                 V8M_SAttributes *sattrs);
+     /* Treat ST1_zpiz (zn[x] + imm) the same way as ST1_zprz (rn + zm[x])
- #endif
+      * by loading the immediate into the scalar parameter.
+      */
-+static void switch_mode(CPUARMState *env, int mode);
+-    imm = tcg_const_i64(a->imm << a->msz);
-+
+-    do_mem_zpz(s, a->rd, a->pg, a->rn, 0, imm, a->msz, true, fn);
- static int vfp_gdb_get_reg(CPUARMState *env, uint8_t *buf, int reg)
+-    tcg_temp_free_i64(imm);
- {
++    do_mem_zpz(s, a->rd, a->pg, a->rn, 0,
-     int nregs;
++               tcg_constant_i64(a->imm << a->msz), a->msz, true, fn);
-@@ -XXX,XX +XXX,XX @@ uint32_t HELPER(v7m_tt)(CPUARMState *env, uint32_t addr, uint32_t op)
+     return true;
      return 0;
  }
--void switch_mode(CPUARMState *env, int mode)
-+static void switch_mode(CPUARMState *env, int mode)
- {
-     ARMCPU *cpu = arm_env_get_cpu(env);
-@@ -XXX,XX +XXX,XX @@ void aarch64_sync_64_to_32(CPUARMState *env)
- #else
--void switch_mode(CPUARMState *env, int mode)
-+static void switch_mode(CPUARMState *env, int mode)
- {
-     int old_mode;
-     int i;
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 44/45] target/arm: Remove writefn from TTBR0_EL3
+[PULL 43/54] target/arm: Use tcg_constant in SUBR
 From: Richard Henderson <richard.henderson@linaro.org>
-The EL3 version of this register does not include an ASID,
-and so the tlb_flush performed by vmsa_ttbr_write is not needed.
-Reviewed-by: Aaron Lindsay <aaron@os.amperecomputing.com>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Message-id: 20181019015617.22583-2-richard.henderson@linaro.org
+Message-id: 20220426163043.100432-44-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper.c | 2 +-
+ target/arm/translate-sve.c | 4 +---
-file changed, 1 insertion(+), 1 deletion(-)
+file changed, 1 insertion(+), 3 deletions(-)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/helper.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo el3_cp_reginfo[] = {
+@@ -XXX,XX +XXX,XX @@ static bool trans_SUBR_zzi(DisasContext *s, arg_rri_esz *a)
-       .fieldoffset = offsetof(CPUARMState, cp15.mvbar) },
+     }
-     { .name = "TTBR0_EL3", .state = ARM_CP_STATE_AA64,
+     if (sve_access_check(s)) {
-       .opc0 = 3, .opc1 = 6, .crn = 2, .crm = 0, .opc2 = 0,
+         unsigned vsz = vec_full_reg_size(s);
--      .access = PL3_RW, .writefn = vmsa_ttbr_write, .resetvalue = 0,
+-        TCGv_i64 c = tcg_const_i64(a->imm);
-+      .access = PL3_RW, .resetvalue = 0,
+         tcg_gen_gvec_2s(vec_full_reg_offset(s, a->rd),
-       .fieldoffset = offsetof(CPUARMState, cp15.ttbr0_el[3]) },
+                         vec_full_reg_offset(s, a->rn),
-     { .name = "TCR_EL3", .state = ARM_CP_STATE_AA64,
+-                        vsz, vsz, c, &op[a->esz]);
-       .opc0 = 3, .opc1 = 6, .crn = 2, .crm = 0, .opc2 = 2,
+-        tcg_temp_free_i64(c);
 +                        vsz, vsz, tcg_constant_i64(a->imm), &op[a->esz]);
      }
      return true;
  }
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 08/45] target/arm: Convert t32ee from feature bit to isar3 test
+[PULL 44/54] target/arm: Use tcg_constant in do_zzi_{sat, ool}, do_fp_imm
 From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181016223115.24100-7-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-45-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.h     | 6 +++++-
+ target/arm/translate-sve.c | 15 +++++----------
- linux-user/elfload.c | 2 +-
+file changed, 5 insertions(+), 10 deletions(-)
  target/arm/cpu.c     | 4 ----
  target/arm/helper.c  | 2 +-
  target/arm/machine.c | 3 +--
 files changed, 8 insertions(+), 9 deletions(-)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/cpu.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ enum arm_features {
+@@ -XXX,XX +XXX,XX @@ static bool do_zzi_sat(DisasContext *s, arg_rri_esz *a, bool u, bool d)
-     ARM_FEATURE_NEON,
+         return false;
-     ARM_FEATURE_M, /* Microcontroller profile.  */
+     }
-     ARM_FEATURE_OMAPCP, /* OMAP specific CP15 ops handling.  */
+     if (sve_access_check(s)) {
--    ARM_FEATURE_THUMB2EE,
+-        TCGv_i64 val = tcg_const_i64(a->imm);
-     ARM_FEATURE_V7MP,    /* v7 Multiprocessing Extensions */
+-        do_sat_addsub_vec(s, a->esz, a->rd, a->rn, val, u, d);
-     ARM_FEATURE_V7VE, /* v7 Virtualization Extensions (non-EL2 parts) */
+-        tcg_temp_free_i64(val);
-     ARM_FEATURE_V4T,
++        do_sat_addsub_vec(s, a->esz, a->rd, a->rn,
-@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_jazelle(const ARMISARegisters *id)
++                          tcg_constant_i64(a->imm), u, d);
-     return FIELD_EX32(id->id_isar1, ID_ISAR1, JAZELLE) != 0;
+     }
      return true;
  }
+@@ -XXX,XX +XXX,XX @@ static bool do_zzi_ool(DisasContext *s, arg_rri_esz *a, gen_helper_gvec_2i *fn)
 +static inline bool isar_feature_t32ee(const ARMISARegisters *id)
 +{
 +    return FIELD_EX32(id->id_isar3, ID_ISAR3, T32EE) != 0;
 +}
 +
  static inline bool isar_feature_aa32_aes(const ARMISARegisters *id)
  {
-     return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) != 0;
+     if (sve_access_check(s)) {
-diff --git a/linux-user/elfload.c b/linux-user/elfload.c
+         unsigned vsz = vec_full_reg_size(s);
-index XXXXXXX..XXXXXXX 100644
+-        TCGv_i64 c = tcg_const_i64(a->imm);
---- a/linux-user/elfload.c
+-
-+++ b/linux-user/elfload.c
+         tcg_gen_gvec_2i_ool(vec_full_reg_offset(s, a->rd),
-@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
+                             vec_full_reg_offset(s, a->rn),
-     GET_FEATURE(ARM_FEATURE_V5, ARM_HWCAP_ARM_EDSP);
+-                            c, vsz, vsz, 0, fn);
-     GET_FEATURE(ARM_FEATURE_VFP, ARM_HWCAP_ARM_VFP);
+-        tcg_temp_free_i64(c);
-     GET_FEATURE(ARM_FEATURE_IWMMXT, ARM_HWCAP_ARM_IWMMXT);
++                            tcg_constant_i64(a->imm), vsz, vsz, 0, fn);
 -    GET_FEATURE(ARM_FEATURE_THUMB2EE, ARM_HWCAP_ARM_THUMBEE);
 +    GET_FEATURE_ID(t32ee, ARM_HWCAP_ARM_THUMBEE);
      GET_FEATURE(ARM_FEATURE_NEON, ARM_HWCAP_ARM_NEON);
      GET_FEATURE(ARM_FEATURE_VFP3, ARM_HWCAP_ARM_VFPv3);
      GET_FEATURE(ARM_FEATURE_V6K, ARM_HWCAP_ARM_TLS);
 diff --git a/target/arm/cpu.c b/target/arm/cpu.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu.c
 +++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void cortex_a8_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_V7);
      set_feature(&cpu->env, ARM_FEATURE_VFP3);
      set_feature(&cpu->env, ARM_FEATURE_NEON);
 -    set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
      set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
      set_feature(&cpu->env, ARM_FEATURE_EL3);
      cpu->midr = 0x410fc080;
@@ -XXX,XX +XXX,XX @@ static void cortex_a9_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_VFP3);
      set_feature(&cpu->env, ARM_FEATURE_VFP_FP16);
      set_feature(&cpu->env, ARM_FEATURE_NEON);
 -    set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
      set_feature(&cpu->env, ARM_FEATURE_EL3);
      /* Note that A9 supports the MP extensions even for
       * A9UP and single-core A9MP (which are both different
@@ -XXX,XX +XXX,XX @@ static void cortex_a7_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_V7VE);
      set_feature(&cpu->env, ARM_FEATURE_VFP4);
      set_feature(&cpu->env, ARM_FEATURE_NEON);
 -    set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
      set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
      set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
      set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
@@ -XXX,XX +XXX,XX @@ static void cortex_a15_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_V7VE);
      set_feature(&cpu->env, ARM_FEATURE_VFP4);
      set_feature(&cpu->env, ARM_FEATURE_NEON);
 -    set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
      set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
      set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
      set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
          define_arm_cp_regs(cpu, vmsa_pmsa_cp_reginfo);
          define_arm_cp_regs(cpu, vmsa_cp_reginfo);
      }
--    if (arm_feature(env, ARM_FEATURE_THUMB2EE)) {
+     return true;
-+    if (cpu_isar_feature(t32ee, cpu)) {
+ }
-         define_arm_cp_regs(cpu, t2ee_cp_reginfo);
+@@ -XXX,XX +XXX,XX @@ static void do_fp_scalar(DisasContext *s, int zd, int zn, int pg, bool is_fp16,
-     }
+ static void do_fp_imm(DisasContext *s, arg_rpri_esz *a, uint64_t imm,
-     if (arm_feature(env, ARM_FEATURE_GENERIC_TIMER)) {
+                       gen_helper_sve_fp2scalar *fn)
 diff --git a/target/arm/machine.c b/target/arm/machine.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/machine.c
 +++ b/target/arm/machine.c
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_m = {
  static bool thumb2ee_needed(void *opaque)
  {
-     ARMCPU *cpu = opaque;
+-    TCGv_i64 temp = tcg_const_i64(imm);
--    CPUARMState *env = &cpu->env;
+-    do_fp_scalar(s, a->rd, a->rn, a->pg, a->esz == MO_16, temp, fn);
+-    tcg_temp_free_i64(temp);
--    return arm_feature(env, ARM_FEATURE_THUMB2EE);
++    do_fp_scalar(s, a->rd, a->rn, a->pg, a->esz == MO_16,
-+    return cpu_isar_feature(t32ee, cpu);
++                 tcg_constant_i64(imm), fn);
  }
- static const VMStateDescription vmstate_thumb2ee = {
+ #define DO_FP_IMM(NAME, name, const0, const1) \
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 03/45] target/arm: Move some system registers into a substructure
+[PULL 45/54] target/arm: Use tcg_constant for predicate descriptors
 From: Richard Henderson <richard.henderson@linaro.org>
-Create struct ARMISARegisters, to be accessed during translation.
+In these cases, 't' did double-duty as zero source and
 temporary destination.  Split the two uses.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181016223115.24100-2-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-46-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.h      |  32 ++++----
+ target/arm/translate-sve.c | 17 ++++++++---------
- hw/intc/armv7m_nvic.c |  12 +--
+file changed, 8 insertions(+), 9 deletions(-)
  target/arm/cpu.c      | 178 +++++++++++++++++++++---------------------
  target/arm/cpu64.c    |  70 ++++++++---------
  target/arm/helper.c   |  28 +++----
 files changed, 162 insertions(+), 158 deletions(-)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/cpu.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ struct ARMCPU {
+@@ -XXX,XX +XXX,XX @@ static void do_predtest(DisasContext *s, int dofs, int gofs, int words)
-      * ARMv7AR ARM Architecture Reference Manual. A reset_ prefix
+ {
-      * is used for reset values of non-constant registers; no reset_
+     TCGv_ptr dptr = tcg_temp_new_ptr();
-      * prefix means a constant register.
+     TCGv_ptr gptr = tcg_temp_new_ptr();
-+     * Some of these registers are split out into a substructure that
+-    TCGv_i32 t;
-+     * is shared with the translators to control the ISA.
++    TCGv_i32 t = tcg_temp_new_i32();
-      */
-+    struct ARMISARegisters {
+     tcg_gen_addi_ptr(dptr, cpu_env, dofs);
-+        uint32_t id_isar0;
+     tcg_gen_addi_ptr(gptr, cpu_env, gofs);
-+        uint32_t id_isar1;
+-    t = tcg_const_i32(words);
-+        uint32_t id_isar2;
-+        uint32_t id_isar3;
+-    gen_helper_sve_predtest(t, dptr, gptr, t);
-+        uint32_t id_isar4;
++    gen_helper_sve_predtest(t, dptr, gptr, tcg_constant_i32(words));
-+        uint32_t id_isar5;
+     tcg_temp_free_ptr(dptr);
-+        uint32_t id_isar6;
+     tcg_temp_free_ptr(gptr);
-+        uint32_t mvfr0;
-+        uint32_t mvfr1;
+@@ -XXX,XX +XXX,XX @@ static bool do_pfirst_pnext(DisasContext *s, arg_rr_esz *a,
-+        uint32_t mvfr2;
-+        uint64_t id_aa64isar0;
+     tcg_gen_addi_ptr(t_pd, cpu_env, pred_full_reg_offset(s, a->rd));
-+        uint64_t id_aa64isar1;
+     tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, a->rn));
-+        uint64_t id_aa64pfr0;
+-    t = tcg_const_i32(desc);
-+        uint64_t id_aa64pfr1;
++    t = tcg_temp_new_i32();
-+    } isar;
-     uint32_t midr;
+-    gen_fn(t, t_pd, t_pg, t);
-     uint32_t revidr;
++    gen_fn(t, t_pd, t_pg, tcg_constant_i32(desc));
-     uint32_t reset_fpsid;
+     tcg_temp_free_ptr(t_pd);
--    uint32_t mvfr0;
+     tcg_temp_free_ptr(t_pg);
--    uint32_t mvfr1;
--    uint32_t mvfr2;
+@@ -XXX,XX +XXX,XX @@ static bool do_ppzz_flags(DisasContext *s, arg_rprr_esz *a,
      uint32_t ctr;
      uint32_t reset_sctlr;
      uint32_t id_pfr0;
@@ -XXX,XX +XXX,XX @@ struct ARMCPU {
      uint32_t id_mmfr2;
      uint32_t id_mmfr3;
      uint32_t id_mmfr4;
 -    uint32_t id_isar0;
 -    uint32_t id_isar1;
 -    uint32_t id_isar2;
 -    uint32_t id_isar3;
 -    uint32_t id_isar4;
 -    uint32_t id_isar5;
 -    uint32_t id_isar6;
 -    uint64_t id_aa64pfr0;
 -    uint64_t id_aa64pfr1;
      uint64_t id_aa64dfr0;
      uint64_t id_aa64dfr1;
      uint64_t id_aa64afr0;
      uint64_t id_aa64afr1;
 -    uint64_t id_aa64isar0;
 -    uint64_t id_aa64isar1;
      uint64_t id_aa64mmfr0;
      uint64_t id_aa64mmfr1;
      uint32_t dbgdidr;
 diff --git a/hw/intc/armv7m_nvic.c b/hw/intc/armv7m_nvic.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/intc/armv7m_nvic.c
 +++ b/hw/intc/armv7m_nvic.c
@@ -XXX,XX +XXX,XX @@ static uint32_t nvic_readl(NVICState *s, uint32_t offset, MemTxAttrs attrs)
      case 0xd5c: /* MMFR3.  */
          return cpu->id_mmfr3;
      case 0xd60: /* ISAR0.  */
 -        return cpu->id_isar0;
 +        return cpu->isar.id_isar0;
      case 0xd64: /* ISAR1.  */
 -        return cpu->id_isar1;
 +        return cpu->isar.id_isar1;
      case 0xd68: /* ISAR2.  */
 -        return cpu->id_isar2;
 +        return cpu->isar.id_isar2;
      case 0xd6c: /* ISAR3.  */
 -        return cpu->id_isar3;
 +        return cpu->isar.id_isar3;
      case 0xd70: /* ISAR4.  */
 -        return cpu->id_isar4;
 +        return cpu->isar.id_isar4;
      case 0xd74: /* ISAR5.  */
 -        return cpu->id_isar5;
 +        return cpu->isar.id_isar5;
      case 0xd78: /* CLIDR */
          return cpu->clidr;
      case 0xd7c: /* CTR */
 diff --git a/target/arm/cpu.c b/target/arm/cpu.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu.c
 +++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_reset(CPUState *s)
      g_hash_table_foreach(cpu->cp_regs, cp_reg_check_reset, cpu);
      env->vfp.xregs[ARM_VFP_FPSID] = cpu->reset_fpsid;
 -    env->vfp.xregs[ARM_VFP_MVFR0] = cpu->mvfr0;
 -    env->vfp.xregs[ARM_VFP_MVFR1] = cpu->mvfr1;
 -    env->vfp.xregs[ARM_VFP_MVFR2] = cpu->mvfr2;
 +    env->vfp.xregs[ARM_VFP_MVFR0] = cpu->isar.mvfr0;
 +    env->vfp.xregs[ARM_VFP_MVFR1] = cpu->isar.mvfr1;
 +    env->vfp.xregs[ARM_VFP_MVFR2] = cpu->isar.mvfr2;
      cpu->power_state = cpu->start_powered_off ? PSCI_OFF : PSCI_ON;
      s->halted = cpu->start_powered_off;
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
           * registers as well. These are id_pfr1[7:4] and id_aa64pfr0[15:12].
           */
          cpu->id_pfr1 &= ~0xf0;
 -        cpu->id_aa64pfr0 &= ~0xf000;
 +        cpu->isar.id_aa64pfr0 &= ~0xf000;
      }
-     if (!cpu->has_el2) {
+     vsz = vec_full_reg_size(s);
-@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
+-    t = tcg_const_i32(simd_desc(vsz, vsz, 0));
-          * registers if we don't have EL2. These are id_pfr1[15:12] and
++    t = tcg_temp_new_i32();
-          * id_aa64pfr0_el1[11:8].
+     pd = tcg_temp_new_ptr();
-          */
+     zn = tcg_temp_new_ptr();
--        cpu->id_aa64pfr0 &= ~0xf00;
+     zm = tcg_temp_new_ptr();
-+        cpu->isar.id_aa64pfr0 &= ~0xf00;
+@@ -XXX,XX +XXX,XX @@ static bool do_ppzz_flags(DisasContext *s, arg_rprr_esz *a,
-         cpu->id_pfr1 &= ~0xf000;
+     tcg_gen_addi_ptr(zm, cpu_env, vec_full_reg_offset(s, a->rm));
      tcg_gen_addi_ptr(pg, cpu_env, pred_full_reg_offset(s, a->pg));
 -    gen_fn(t, pd, zn, zm, pg, t);
 +    gen_fn(t, pd, zn, zm, pg, tcg_constant_i32(simd_desc(vsz, vsz, 0)));
      tcg_temp_free_ptr(pd);
      tcg_temp_free_ptr(zn);
@@ -XXX,XX +XXX,XX @@ static bool do_ppzi_flags(DisasContext *s, arg_rpri_esz *a,
      }
-@@ -XXX,XX +XXX,XX @@ static void arm1136_r2_initfn(Object *obj)
+     vsz = vec_full_reg_size(s);
-     set_feature(&cpu->env, ARM_FEATURE_CACHE_BLOCK_OPS);
+-    t = tcg_const_i32(simd_desc(vsz, vsz, a->imm));
-     cpu->midr = 0x4107b362;
++    t = tcg_temp_new_i32();
-     cpu->reset_fpsid = 0x410120b4;
+     pd = tcg_temp_new_ptr();
--    cpu->mvfr0 = 0x11111111;
+     zn = tcg_temp_new_ptr();
--    cpu->mvfr1 = 0x00000000;
+     pg = tcg_temp_new_ptr();
-+    cpu->isar.mvfr0 = 0x11111111;
+@@ -XXX,XX +XXX,XX @@ static bool do_ppzi_flags(DisasContext *s, arg_rpri_esz *a,
-+    cpu->isar.mvfr1 = 0x00000000;
+     tcg_gen_addi_ptr(zn, cpu_env, vec_full_reg_offset(s, a->rn));
-     cpu->ctr = 0x1dd20d2;
+     tcg_gen_addi_ptr(pg, cpu_env, pred_full_reg_offset(s, a->pg));
-     cpu->reset_sctlr = 0x00050078;
-     cpu->id_pfr0 = 0x111;
+-    gen_fn(t, pd, zn, pg, t);
-@@ -XXX,XX +XXX,XX @@ static void arm1136_r2_initfn(Object *obj)
++    gen_fn(t, pd, zn, pg, tcg_constant_i32(simd_desc(vsz, vsz, a->imm)));
-     cpu->id_mmfr0 = 0x01130003;
-     cpu->id_mmfr1 = 0x10030302;
+     tcg_temp_free_ptr(pd);
-     cpu->id_mmfr2 = 0x01222110;
+     tcg_temp_free_ptr(zn);
 -    cpu->id_isar0 = 0x00140011;
 -    cpu->id_isar1 = 0x12002111;
 -    cpu->id_isar2 = 0x11231111;
 -    cpu->id_isar3 = 0x01102131;
 -    cpu->id_isar4 = 0x141;
 +    cpu->isar.id_isar0 = 0x00140011;
 +    cpu->isar.id_isar1 = 0x12002111;
 +    cpu->isar.id_isar2 = 0x11231111;
 +    cpu->isar.id_isar3 = 0x01102131;
 +    cpu->isar.id_isar4 = 0x141;
      cpu->reset_auxcr = 7;
  }
@@ -XXX,XX +XXX,XX @@ static void arm1136_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_CACHE_BLOCK_OPS);
      cpu->midr = 0x4117b363;
      cpu->reset_fpsid = 0x410120b4;
 -    cpu->mvfr0 = 0x11111111;
 -    cpu->mvfr1 = 0x00000000;
 +    cpu->isar.mvfr0 = 0x11111111;
 +    cpu->isar.mvfr1 = 0x00000000;
      cpu->ctr = 0x1dd20d2;
      cpu->reset_sctlr = 0x00050078;
      cpu->id_pfr0 = 0x111;
@@ -XXX,XX +XXX,XX @@ static void arm1136_initfn(Object *obj)
      cpu->id_mmfr0 = 0x01130003;
      cpu->id_mmfr1 = 0x10030302;
      cpu->id_mmfr2 = 0x01222110;
 -    cpu->id_isar0 = 0x00140011;
 -    cpu->id_isar1 = 0x12002111;
 -    cpu->id_isar2 = 0x11231111;
 -    cpu->id_isar3 = 0x01102131;
 -    cpu->id_isar4 = 0x141;
 +    cpu->isar.id_isar0 = 0x00140011;
 +    cpu->isar.id_isar1 = 0x12002111;
 +    cpu->isar.id_isar2 = 0x11231111;
 +    cpu->isar.id_isar3 = 0x01102131;
 +    cpu->isar.id_isar4 = 0x141;
      cpu->reset_auxcr = 7;
  }
@@ -XXX,XX +XXX,XX @@ static void arm1176_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_EL3);
      cpu->midr = 0x410fb767;
      cpu->reset_fpsid = 0x410120b5;
 -    cpu->mvfr0 = 0x11111111;
 -    cpu->mvfr1 = 0x00000000;
 +    cpu->isar.mvfr0 = 0x11111111;
 +    cpu->isar.mvfr1 = 0x00000000;
      cpu->ctr = 0x1dd20d2;
      cpu->reset_sctlr = 0x00050078;
      cpu->id_pfr0 = 0x111;
@@ -XXX,XX +XXX,XX @@ static void arm1176_initfn(Object *obj)
      cpu->id_mmfr0 = 0x01130003;
      cpu->id_mmfr1 = 0x10030302;
      cpu->id_mmfr2 = 0x01222100;
 -    cpu->id_isar0 = 0x0140011;
 -    cpu->id_isar1 = 0x12002111;
 -    cpu->id_isar2 = 0x11231121;
 -    cpu->id_isar3 = 0x01102131;
 -    cpu->id_isar4 = 0x01141;
 +    cpu->isar.id_isar0 = 0x0140011;
 +    cpu->isar.id_isar1 = 0x12002111;
 +    cpu->isar.id_isar2 = 0x11231121;
 +    cpu->isar.id_isar3 = 0x01102131;
 +    cpu->isar.id_isar4 = 0x01141;
      cpu->reset_auxcr = 7;
  }
@@ -XXX,XX +XXX,XX @@ static void arm11mpcore_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
      cpu->midr = 0x410fb022;
      cpu->reset_fpsid = 0x410120b4;
 -    cpu->mvfr0 = 0x11111111;
 -    cpu->mvfr1 = 0x00000000;
 +    cpu->isar.mvfr0 = 0x11111111;
 +    cpu->isar.mvfr1 = 0x00000000;
      cpu->ctr = 0x1d192992; /* 32K icache 32K dcache */
      cpu->id_pfr0 = 0x111;
      cpu->id_pfr1 = 0x1;
@@ -XXX,XX +XXX,XX @@ static void arm11mpcore_initfn(Object *obj)
      cpu->id_mmfr0 = 0x01100103;
      cpu->id_mmfr1 = 0x10020302;
      cpu->id_mmfr2 = 0x01222000;
 -    cpu->id_isar0 = 0x00100011;
 -    cpu->id_isar1 = 0x12002111;
 -    cpu->id_isar2 = 0x11221011;
 -    cpu->id_isar3 = 0x01102131;
 -    cpu->id_isar4 = 0x141;
 +    cpu->isar.id_isar0 = 0x00100011;
 +    cpu->isar.id_isar1 = 0x12002111;
 +    cpu->isar.id_isar2 = 0x11221011;
 +    cpu->isar.id_isar3 = 0x01102131;
 +    cpu->isar.id_isar4 = 0x141;
      cpu->reset_auxcr = 1;
  }
@@ -XXX,XX +XXX,XX @@ static void cortex_m3_initfn(Object *obj)
      cpu->id_mmfr1 = 0x00000000;
      cpu->id_mmfr2 = 0x00000000;
      cpu->id_mmfr3 = 0x00000000;
 -    cpu->id_isar0 = 0x01141110;
 -    cpu->id_isar1 = 0x02111000;
 -    cpu->id_isar2 = 0x21112231;
 -    cpu->id_isar3 = 0x01111110;
 -    cpu->id_isar4 = 0x01310102;
 -    cpu->id_isar5 = 0x00000000;
 -    cpu->id_isar6 = 0x00000000;
 +    cpu->isar.id_isar0 = 0x01141110;
 +    cpu->isar.id_isar1 = 0x02111000;
 +    cpu->isar.id_isar2 = 0x21112231;
 +    cpu->isar.id_isar3 = 0x01111110;
 +    cpu->isar.id_isar4 = 0x01310102;
 +    cpu->isar.id_isar5 = 0x00000000;
 +    cpu->isar.id_isar6 = 0x00000000;
  }
  static void cortex_m4_initfn(Object *obj)
@@ -XXX,XX +XXX,XX @@ static void cortex_m4_initfn(Object *obj)
      cpu->id_mmfr1 = 0x00000000;
      cpu->id_mmfr2 = 0x00000000;
      cpu->id_mmfr3 = 0x00000000;
 -    cpu->id_isar0 = 0x01141110;
 -    cpu->id_isar1 = 0x02111000;
 -    cpu->id_isar2 = 0x21112231;
 -    cpu->id_isar3 = 0x01111110;
 -    cpu->id_isar4 = 0x01310102;
 -    cpu->id_isar5 = 0x00000000;
 -    cpu->id_isar6 = 0x00000000;
 +    cpu->isar.id_isar0 = 0x01141110;
 +    cpu->isar.id_isar1 = 0x02111000;
 +    cpu->isar.id_isar2 = 0x21112231;
 +    cpu->isar.id_isar3 = 0x01111110;
 +    cpu->isar.id_isar4 = 0x01310102;
 +    cpu->isar.id_isar5 = 0x00000000;
 +    cpu->isar.id_isar6 = 0x00000000;
  }
  static void cortex_m33_initfn(Object *obj)
@@ -XXX,XX +XXX,XX @@ static void cortex_m33_initfn(Object *obj)
      cpu->id_mmfr1 = 0x00000000;
      cpu->id_mmfr2 = 0x01000000;
      cpu->id_mmfr3 = 0x00000000;
 -    cpu->id_isar0 = 0x01101110;
 -    cpu->id_isar1 = 0x02212000;
 -    cpu->id_isar2 = 0x20232232;
 -    cpu->id_isar3 = 0x01111131;
 -    cpu->id_isar4 = 0x01310132;
 -    cpu->id_isar5 = 0x00000000;
 -    cpu->id_isar6 = 0x00000000;
 +    cpu->isar.id_isar0 = 0x01101110;
 +    cpu->isar.id_isar1 = 0x02212000;
 +    cpu->isar.id_isar2 = 0x20232232;
 +    cpu->isar.id_isar3 = 0x01111131;
 +    cpu->isar.id_isar4 = 0x01310132;
 +    cpu->isar.id_isar5 = 0x00000000;
 +    cpu->isar.id_isar6 = 0x00000000;
      cpu->clidr = 0x00000000;
      cpu->ctr = 0x8000c000;
  }
@@ -XXX,XX +XXX,XX @@ static void cortex_r5_initfn(Object *obj)
      cpu->id_mmfr1 = 0x00000000;
      cpu->id_mmfr2 = 0x01200000;
      cpu->id_mmfr3 = 0x0211;
 -    cpu->id_isar0 = 0x02101111;
 -    cpu->id_isar1 = 0x13112111;
 -    cpu->id_isar2 = 0x21232141;
 -    cpu->id_isar3 = 0x01112131;
 -    cpu->id_isar4 = 0x0010142;
 -    cpu->id_isar5 = 0x0;
 -    cpu->id_isar6 = 0x0;
 +    cpu->isar.id_isar0 = 0x02101111;
 +    cpu->isar.id_isar1 = 0x13112111;
 +    cpu->isar.id_isar2 = 0x21232141;
 +    cpu->isar.id_isar3 = 0x01112131;
 +    cpu->isar.id_isar4 = 0x0010142;
 +    cpu->isar.id_isar5 = 0x0;
 +    cpu->isar.id_isar6 = 0x0;
      cpu->mp_is_up = true;
      cpu->pmsav7_dregion = 16;
      define_arm_cp_regs(cpu, cortexr5_cp_reginfo);
@@ -XXX,XX +XXX,XX @@ static void cortex_a8_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_EL3);
      cpu->midr = 0x410fc080;
      cpu->reset_fpsid = 0x410330c0;
 -    cpu->mvfr0 = 0x11110222;
 -    cpu->mvfr1 = 0x00011111;
 +    cpu->isar.mvfr0 = 0x11110222;
 +    cpu->isar.mvfr1 = 0x00011111;
      cpu->ctr = 0x82048004;
      cpu->reset_sctlr = 0x00c50078;
      cpu->id_pfr0 = 0x1031;
@@ -XXX,XX +XXX,XX @@ static void cortex_a8_initfn(Object *obj)
      cpu->id_mmfr1 = 0x20000000;
      cpu->id_mmfr2 = 0x01202000;
      cpu->id_mmfr3 = 0x11;
 -    cpu->id_isar0 = 0x00101111;
 -    cpu->id_isar1 = 0x12112111;
 -    cpu->id_isar2 = 0x21232031;
 -    cpu->id_isar3 = 0x11112131;
 -    cpu->id_isar4 = 0x00111142;
 +    cpu->isar.id_isar0 = 0x00101111;
 +    cpu->isar.id_isar1 = 0x12112111;
 +    cpu->isar.id_isar2 = 0x21232031;
 +    cpu->isar.id_isar3 = 0x11112131;
 +    cpu->isar.id_isar4 = 0x00111142;
      cpu->dbgdidr = 0x15141000;
      cpu->clidr = (1 << 27) | (2 << 24) | 3;
      cpu->ccsidr[0] = 0xe007e01a; /* 16k L1 dcache. */
@@ -XXX,XX +XXX,XX @@ static void cortex_a9_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_CBAR);
      cpu->midr = 0x410fc090;
      cpu->reset_fpsid = 0x41033090;
 -    cpu->mvfr0 = 0x11110222;
 -    cpu->mvfr1 = 0x01111111;
 +    cpu->isar.mvfr0 = 0x11110222;
 +    cpu->isar.mvfr1 = 0x01111111;
      cpu->ctr = 0x80038003;
      cpu->reset_sctlr = 0x00c50078;
      cpu->id_pfr0 = 0x1031;
@@ -XXX,XX +XXX,XX @@ static void cortex_a9_initfn(Object *obj)
      cpu->id_mmfr1 = 0x20000000;
      cpu->id_mmfr2 = 0x01230000;
      cpu->id_mmfr3 = 0x00002111;
 -    cpu->id_isar0 = 0x00101111;
 -    cpu->id_isar1 = 0x13112111;
 -    cpu->id_isar2 = 0x21232041;
 -    cpu->id_isar3 = 0x11112131;
 -    cpu->id_isar4 = 0x00111142;
 +    cpu->isar.id_isar0 = 0x00101111;
 +    cpu->isar.id_isar1 = 0x13112111;
 +    cpu->isar.id_isar2 = 0x21232041;
 +    cpu->isar.id_isar3 = 0x11112131;
 +    cpu->isar.id_isar4 = 0x00111142;
      cpu->dbgdidr = 0x35141000;
      cpu->clidr = (1 << 27) | (1 << 24) | 3;
      cpu->ccsidr[0] = 0xe00fe019; /* 16k L1 dcache. */
@@ -XXX,XX +XXX,XX @@ static void cortex_a7_initfn(Object *obj)
      cpu->kvm_target = QEMU_KVM_ARM_TARGET_CORTEX_A7;
      cpu->midr = 0x410fc075;
      cpu->reset_fpsid = 0x41023075;
 -    cpu->mvfr0 = 0x10110222;
 -    cpu->mvfr1 = 0x11111111;
 +    cpu->isar.mvfr0 = 0x10110222;
 +    cpu->isar.mvfr1 = 0x11111111;
      cpu->ctr = 0x84448003;
      cpu->reset_sctlr = 0x00c50078;
      cpu->id_pfr0 = 0x00001131;
@@ -XXX,XX +XXX,XX @@ static void cortex_a7_initfn(Object *obj)
      /* a7_mpcore_r0p5_trm, page 4-4 gives 0x01101110; but
       * table 4-41 gives 0x02101110, which includes the arm div insns.
       */
 -    cpu->id_isar0 = 0x02101110;
 -    cpu->id_isar1 = 0x13112111;
 -    cpu->id_isar2 = 0x21232041;
 -    cpu->id_isar3 = 0x11112131;
 -    cpu->id_isar4 = 0x10011142;
 +    cpu->isar.id_isar0 = 0x02101110;
 +    cpu->isar.id_isar1 = 0x13112111;
 +    cpu->isar.id_isar2 = 0x21232041;
 +    cpu->isar.id_isar3 = 0x11112131;
 +    cpu->isar.id_isar4 = 0x10011142;
      cpu->dbgdidr = 0x3515f005;
      cpu->clidr = 0x0a200023;
      cpu->ccsidr[0] = 0x701fe00a; /* 32K L1 dcache */
@@ -XXX,XX +XXX,XX @@ static void cortex_a15_initfn(Object *obj)
      cpu->kvm_target = QEMU_KVM_ARM_TARGET_CORTEX_A15;
      cpu->midr = 0x412fc0f1;
      cpu->reset_fpsid = 0x410430f0;
 -    cpu->mvfr0 = 0x10110222;
 -    cpu->mvfr1 = 0x11111111;
 +    cpu->isar.mvfr0 = 0x10110222;
 +    cpu->isar.mvfr1 = 0x11111111;
      cpu->ctr = 0x8444c004;
      cpu->reset_sctlr = 0x00c50078;
      cpu->id_pfr0 = 0x00001131;
@@ -XXX,XX +XXX,XX @@ static void cortex_a15_initfn(Object *obj)
      cpu->id_mmfr1 = 0x20000000;
      cpu->id_mmfr2 = 0x01240000;
      cpu->id_mmfr3 = 0x02102211;
 -    cpu->id_isar0 = 0x02101110;
 -    cpu->id_isar1 = 0x13112111;
 -    cpu->id_isar2 = 0x21232041;
 -    cpu->id_isar3 = 0x11112131;
 -    cpu->id_isar4 = 0x10011142;
 +    cpu->isar.id_isar0 = 0x02101110;
 +    cpu->isar.id_isar1 = 0x13112111;
 +    cpu->isar.id_isar2 = 0x21232041;
 +    cpu->isar.id_isar3 = 0x11112131;
 +    cpu->isar.id_isar4 = 0x10011142;
      cpu->dbgdidr = 0x3515f021;
      cpu->clidr = 0x0a200023;
      cpu->ccsidr[0] = 0x701fe00a; /* 32K L1 dcache */
 diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu64.c
 +++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_a57_initfn(Object *obj)
      cpu->midr = 0x411fd070;
      cpu->revidr = 0x00000000;
      cpu->reset_fpsid = 0x41034070;
 -    cpu->mvfr0 = 0x10110222;
 -    cpu->mvfr1 = 0x12111111;
 -    cpu->mvfr2 = 0x00000043;
 +    cpu->isar.mvfr0 = 0x10110222;
 +    cpu->isar.mvfr1 = 0x12111111;
 +    cpu->isar.mvfr2 = 0x00000043;
      cpu->ctr = 0x8444c004;
      cpu->reset_sctlr = 0x00c50838;
      cpu->id_pfr0 = 0x00000131;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a57_initfn(Object *obj)
      cpu->id_mmfr1 = 0x40000000;
      cpu->id_mmfr2 = 0x01260000;
      cpu->id_mmfr3 = 0x02102211;
 -    cpu->id_isar0 = 0x02101110;
 -    cpu->id_isar1 = 0x13112111;
 -    cpu->id_isar2 = 0x21232042;
 -    cpu->id_isar3 = 0x01112131;
 -    cpu->id_isar4 = 0x00011142;
 -    cpu->id_isar5 = 0x00011121;
 -    cpu->id_isar6 = 0;
 -    cpu->id_aa64pfr0 = 0x00002222;
 +    cpu->isar.id_isar0 = 0x02101110;
 +    cpu->isar.id_isar1 = 0x13112111;
 +    cpu->isar.id_isar2 = 0x21232042;
 +    cpu->isar.id_isar3 = 0x01112131;
 +    cpu->isar.id_isar4 = 0x00011142;
 +    cpu->isar.id_isar5 = 0x00011121;
 +    cpu->isar.id_isar6 = 0;
 +    cpu->isar.id_aa64pfr0 = 0x00002222;
      cpu->id_aa64dfr0 = 0x10305106;
      cpu->pmceid0 = 0x00000000;
      cpu->pmceid1 = 0x00000000;
 -    cpu->id_aa64isar0 = 0x00011120;
 +    cpu->isar.id_aa64isar0 = 0x00011120;
      cpu->id_aa64mmfr0 = 0x00001124;
      cpu->dbgdidr = 0x3516d000;
      cpu->clidr = 0x0a200023;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a53_initfn(Object *obj)
      cpu->midr = 0x410fd034;
      cpu->revidr = 0x00000000;
      cpu->reset_fpsid = 0x41034070;
 -    cpu->mvfr0 = 0x10110222;
 -    cpu->mvfr1 = 0x12111111;
 -    cpu->mvfr2 = 0x00000043;
 +    cpu->isar.mvfr0 = 0x10110222;
 +    cpu->isar.mvfr1 = 0x12111111;
 +    cpu->isar.mvfr2 = 0x00000043;
      cpu->ctr = 0x84448004; /* L1Ip = VIPT */
      cpu->reset_sctlr = 0x00c50838;
      cpu->id_pfr0 = 0x00000131;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a53_initfn(Object *obj)
      cpu->id_mmfr1 = 0x40000000;
      cpu->id_mmfr2 = 0x01260000;
      cpu->id_mmfr3 = 0x02102211;
 -    cpu->id_isar0 = 0x02101110;
 -    cpu->id_isar1 = 0x13112111;
 -    cpu->id_isar2 = 0x21232042;
 -    cpu->id_isar3 = 0x01112131;
 -    cpu->id_isar4 = 0x00011142;
 -    cpu->id_isar5 = 0x00011121;
 -    cpu->id_isar6 = 0;
 -    cpu->id_aa64pfr0 = 0x00002222;
 +    cpu->isar.id_isar0 = 0x02101110;
 +    cpu->isar.id_isar1 = 0x13112111;
 +    cpu->isar.id_isar2 = 0x21232042;
 +    cpu->isar.id_isar3 = 0x01112131;
 +    cpu->isar.id_isar4 = 0x00011142;
 +    cpu->isar.id_isar5 = 0x00011121;
 +    cpu->isar.id_isar6 = 0;
 +    cpu->isar.id_aa64pfr0 = 0x00002222;
      cpu->id_aa64dfr0 = 0x10305106;
 -    cpu->id_aa64isar0 = 0x00011120;
 +    cpu->isar.id_aa64isar0 = 0x00011120;
      cpu->id_aa64mmfr0 = 0x00001122; /* 40 bit physical addr */
      cpu->dbgdidr = 0x3516d000;
      cpu->clidr = 0x0a200023;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a72_initfn(Object *obj)
      cpu->midr = 0x410fd083;
      cpu->revidr = 0x00000000;
      cpu->reset_fpsid = 0x41034080;
 -    cpu->mvfr0 = 0x10110222;
 -    cpu->mvfr1 = 0x12111111;
 -    cpu->mvfr2 = 0x00000043;
 +    cpu->isar.mvfr0 = 0x10110222;
 +    cpu->isar.mvfr1 = 0x12111111;
 +    cpu->isar.mvfr2 = 0x00000043;
      cpu->ctr = 0x8444c004;
      cpu->reset_sctlr = 0x00c50838;
      cpu->id_pfr0 = 0x00000131;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a72_initfn(Object *obj)
      cpu->id_mmfr1 = 0x40000000;
      cpu->id_mmfr2 = 0x01260000;
      cpu->id_mmfr3 = 0x02102211;
 -    cpu->id_isar0 = 0x02101110;
 -    cpu->id_isar1 = 0x13112111;
 -    cpu->id_isar2 = 0x21232042;
 -    cpu->id_isar3 = 0x01112131;
 -    cpu->id_isar4 = 0x00011142;
 -    cpu->id_isar5 = 0x00011121;
 -    cpu->id_aa64pfr0 = 0x00002222;
 +    cpu->isar.id_isar0 = 0x02101110;
 +    cpu->isar.id_isar1 = 0x13112111;
 +    cpu->isar.id_isar2 = 0x21232042;
 +    cpu->isar.id_isar3 = 0x01112131;
 +    cpu->isar.id_isar4 = 0x00011142;
 +    cpu->isar.id_isar5 = 0x00011121;
 +    cpu->isar.id_aa64pfr0 = 0x00002222;
      cpu->id_aa64dfr0 = 0x10305106;
      cpu->pmceid0 = 0x00000000;
      cpu->pmceid1 = 0x00000000;
 -    cpu->id_aa64isar0 = 0x00011120;
 +    cpu->isar.id_aa64isar0 = 0x00011120;
      cpu->id_aa64mmfr0 = 0x00001124;
      cpu->dbgdidr = 0x3516d000;
      cpu->clidr = 0x0a200023;
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static uint64_t id_pfr1_read(CPUARMState *env, const ARMCPRegInfo *ri)
  static uint64_t id_aa64pfr0_read(CPUARMState *env, const ARMCPRegInfo *ri)
  {
      ARMCPU *cpu = arm_env_get_cpu(env);
 -    uint64_t pfr0 = cpu->id_aa64pfr0;
 +    uint64_t pfr0 = cpu->isar.id_aa64pfr0;
      if (env->gicv3state) {
          pfr0 |= 1 << 24;
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
              { .name = "ID_ISAR0", .state = ARM_CP_STATE_BOTH,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 0,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_isar0 },
 +              .resetvalue = cpu->isar.id_isar0 },
              { .name = "ID_ISAR1", .state = ARM_CP_STATE_BOTH,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 1,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_isar1 },
 +              .resetvalue = cpu->isar.id_isar1 },
              { .name = "ID_ISAR2", .state = ARM_CP_STATE_BOTH,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 2,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_isar2 },
 +              .resetvalue = cpu->isar.id_isar2 },
              { .name = "ID_ISAR3", .state = ARM_CP_STATE_BOTH,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 3,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_isar3 },
 +              .resetvalue = cpu->isar.id_isar3 },
              { .name = "ID_ISAR4", .state = ARM_CP_STATE_BOTH,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 4,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_isar4 },
 +              .resetvalue = cpu->isar.id_isar4 },
              { .name = "ID_ISAR5", .state = ARM_CP_STATE_BOTH,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 5,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_isar5 },
 +              .resetvalue = cpu->isar.id_isar5 },
              { .name = "ID_MMFR4", .state = ARM_CP_STATE_BOTH,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 6,
                .access = PL1_R, .type = ARM_CP_CONST,
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
              { .name = "ID_ISAR6", .state = ARM_CP_STATE_BOTH,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 7,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_isar6 },
 +              .resetvalue = cpu->isar.id_isar6 },
              REGINFO_SENTINEL
          };
          define_arm_cp_regs(cpu, v6_idregs);
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
              { .name = "ID_AA64PFR1_EL1", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 4, .opc2 = 1,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_aa64pfr1},
 +              .resetvalue = cpu->isar.id_aa64pfr1},
              { .name = "ID_AA64PFR2_EL1_RESERVED", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 4, .opc2 = 2,
                .access = PL1_R, .type = ARM_CP_CONST,
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
              { .name = "ID_AA64ISAR0_EL1", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 6, .opc2 = 0,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_aa64isar0 },
 +              .resetvalue = cpu->isar.id_aa64isar0 },
              { .name = "ID_AA64ISAR1_EL1", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 6, .opc2 = 1,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_aa64isar1 },
 +              .resetvalue = cpu->isar.id_aa64isar1 },
              { .name = "ID_AA64ISAR2_EL1_RESERVED", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 6, .opc2 = 2,
                .access = PL1_R, .type = ARM_CP_CONST,
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
              { .name = "MVFR0_EL1", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 3, .opc2 = 0,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->mvfr0 },
 +              .resetvalue = cpu->isar.mvfr0 },
              { .name = "MVFR1_EL1", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 3, .opc2 = 1,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->mvfr1 },
 +              .resetvalue = cpu->isar.mvfr1 },
              { .name = "MVFR2_EL1", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 3, .opc2 = 2,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->mvfr2 },
 +              .resetvalue = cpu->isar.mvfr2 },
              { .name = "MVFR3_EL1_RESERVED", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 3, .opc2 = 3,
                .access = PL1_R, .type = ARM_CP_CONST,
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 07/45] target/arm: Convert jazelle from feature bit to isar1 test
+[PULL 46/54] target/arm: Use tcg_constant for do_brk{2,3}
 From: Richard Henderson <richard.henderson@linaro.org>
-Having V6 alone imply jazelle was wrong for cortex-m0.
+In these cases, 't' did double-duty as zero source and
-Change to an assertion for V6 & !M.
+temporary destination.  Split the two uses and narrow
 the scope of the temp.
-This was harmless, because the only place we tested ARM_FEATURE_JAZELLE
-was for 'bxj' in disas_arm(), which is unreachable for M-profile cores.
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181016223115.24100-6-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-47-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.h       |  6 +++++-
+ target/arm/translate-sve.c | 18 ++++++++++--------
- target/arm/cpu.c       | 17 ++++++++++++++---
+file changed, 10 insertions(+), 8 deletions(-)
  target/arm/translate.c |  2 +-
 files changed, 20 insertions(+), 5 deletions(-)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/cpu.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ enum arm_features {
+@@ -XXX,XX +XXX,XX @@ static bool do_brk3(DisasContext *s, arg_rprr_s *a,
-     ARM_FEATURE_PMU, /* has PMU support */
+     TCGv_ptr n = tcg_temp_new_ptr();
-     ARM_FEATURE_VBAR, /* has cp15 VBAR */
+     TCGv_ptr m = tcg_temp_new_ptr();
-     ARM_FEATURE_M_SECURITY, /* M profile Security Extension */
+     TCGv_ptr g = tcg_temp_new_ptr();
--    ARM_FEATURE_JAZELLE, /* has (trivial) Jazelle implementation */
+-    TCGv_i32 t = tcg_const_i32(FIELD_DP32(0, PREDDESC, OPRSZ, vsz));
-     ARM_FEATURE_SVE, /* has Scalable Vector Extension */
++    TCGv_i32 desc = tcg_constant_i32(FIELD_DP32(0, PREDDESC, OPRSZ, vsz));
-     ARM_FEATURE_V8_FP16, /* implements v8.2 half-precision float */
-     ARM_FEATURE_M_MAIN, /* M profile Main Extension */
+     tcg_gen_addi_ptr(d, cpu_env, pred_full_reg_offset(s, a->rd));
-@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_arm_div(const ARMISARegisters *id)
+     tcg_gen_addi_ptr(n, cpu_env, pred_full_reg_offset(s, a->rn));
-     return FIELD_EX32(id->id_isar0, ID_ISAR0, DIVIDE) > 1;
+@@ -XXX,XX +XXX,XX @@ static bool do_brk3(DisasContext *s, arg_rprr_s *a,
      tcg_gen_addi_ptr(g, cpu_env, pred_full_reg_offset(s, a->pg));
      if (a->s) {
 -        fn_s(t, d, n, m, g, t);
 +        TCGv_i32 t = tcg_temp_new_i32();
 +        fn_s(t, d, n, m, g, desc);
          do_pred_flags(t);
 +        tcg_temp_free_i32(t);
      } else {
 -        fn(d, n, m, g, t);
 +        fn(d, n, m, g, desc);
      }
      tcg_temp_free_ptr(d);
      tcg_temp_free_ptr(n);
      tcg_temp_free_ptr(m);
      tcg_temp_free_ptr(g);
 -    tcg_temp_free_i32(t);
      return true;
  }
-+static inline bool isar_feature_jazelle(const ARMISARegisters *id)
+@@ -XXX,XX +XXX,XX @@ static bool do_brk2(DisasContext *s, arg_rpr_s *a,
-+{
+     TCGv_ptr d = tcg_temp_new_ptr();
-+    return FIELD_EX32(id->id_isar1, ID_ISAR1, JAZELLE) != 0;
+     TCGv_ptr n = tcg_temp_new_ptr();
-+}
+     TCGv_ptr g = tcg_temp_new_ptr();
-+
+-    TCGv_i32 t = tcg_const_i32(FIELD_DP32(0, PREDDESC, OPRSZ, vsz));
- static inline bool isar_feature_aa32_aes(const ARMISARegisters *id)
++    TCGv_i32 desc = tcg_constant_i32(FIELD_DP32(0, PREDDESC, OPRSZ, vsz));
- {
-     return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) != 0;
+     tcg_gen_addi_ptr(d, cpu_env, pred_full_reg_offset(s, a->rd));
-diff --git a/target/arm/cpu.c b/target/arm/cpu.c
+     tcg_gen_addi_ptr(n, cpu_env, pred_full_reg_offset(s, a->rn));
-index XXXXXXX..XXXXXXX 100644
+     tcg_gen_addi_ptr(g, cpu_env, pred_full_reg_offset(s, a->pg));
---- a/target/arm/cpu.c
-+++ b/target/arm/cpu.c
+     if (a->s) {
-@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
+-        fn_s(t, d, n, g, t);
 +        TCGv_i32 t = tcg_temp_new_i32();
 +        fn_s(t, d, n, g, desc);
          do_pred_flags(t);
 +        tcg_temp_free_i32(t);
      } else {
 -        fn(d, n, g, t);
 +        fn(d, n, g, desc);
      }
-     if (arm_feature(env, ARM_FEATURE_V6)) {
+     tcg_temp_free_ptr(d);
-         set_feature(env, ARM_FEATURE_V5);
+     tcg_temp_free_ptr(n);
--        set_feature(env, ARM_FEATURE_JAZELLE);
+     tcg_temp_free_ptr(g);
-         if (!arm_feature(env, ARM_FEATURE_M)) {
+-    tcg_temp_free_i32(t);
-+            assert(cpu_isar_feature(jazelle, cpu));
+     return true;
              set_feature(env, ARM_FEATURE_AUXCR);
          }
      }
@@ -XXX,XX +XXX,XX @@ static void arm926_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_VFP);
      set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
      set_feature(&cpu->env, ARM_FEATURE_CACHE_TEST_CLEAN);
 -    set_feature(&cpu->env, ARM_FEATURE_JAZELLE);
      cpu->midr = 0x41069265;
      cpu->reset_fpsid = 0x41011090;
      cpu->ctr = 0x1dd20d2;
      cpu->reset_sctlr = 0x00090078;
 +
 +    /*
 +     * ARMv5 does not have the ID_ISAR registers, but we can still
 +     * set the field to indicate Jazelle support within QEMU.
 +     */
 +    cpu->isar.id_isar1 = FIELD_DP32(cpu->isar.id_isar1, ID_ISAR1, JAZELLE, 1);
  }
- static void arm946_initfn(Object *obj)
-@@ -XXX,XX +XXX,XX @@ static void arm1026_initfn(Object *obj)
-     set_feature(&cpu->env, ARM_FEATURE_AUXCR);
-     set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
-     set_feature(&cpu->env, ARM_FEATURE_CACHE_TEST_CLEAN);
--    set_feature(&cpu->env, ARM_FEATURE_JAZELLE);
-     cpu->midr = 0x4106a262;
-     cpu->reset_fpsid = 0x410110a0;
-     cpu->ctr = 0x1dd20d2;
-     cpu->reset_sctlr = 0x00090078;
-     cpu->reset_auxcr = 1;
-+
-+    /*
-+     * ARMv5 does not have the ID_ISAR registers, but we can still
-+     * set the field to indicate Jazelle support within QEMU.
-+     */
-+    cpu->isar.id_isar1 = FIELD_DP32(cpu->isar.id_isar1, ID_ISAR1, JAZELLE, 1);
-+
-     {
-         /* The 1026 had an IFAR at c6,c0,0,1 rather than the ARMv6 c6,c0,0,2 */
-         ARMCPRegInfo ifar = {
-diff --git a/target/arm/translate.c b/target/arm/translate.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
-+++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@
- #define ENABLE_ARCH_5     arm_dc_feature(s, ARM_FEATURE_V5)
- /* currently all emulated v5 cores are also v5TE, so don't bother */
- #define ENABLE_ARCH_5TE   arm_dc_feature(s, ARM_FEATURE_V5)
--#define ENABLE_ARCH_5J    arm_dc_feature(s, ARM_FEATURE_JAZELLE)
-+#define ENABLE_ARCH_5J    dc_isar_feature(jazelle, s)
- #define ENABLE_ARCH_6     arm_dc_feature(s, ARM_FEATURE_V6)
- #define ENABLE_ARCH_6K    arm_dc_feature(s, ARM_FEATURE_V6K)
- #define ENABLE_ARCH_6T2   arm_dc_feature(s, ARM_FEATURE_THUMB2)
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 43/45] net: cadence_gem: Announce 64bit addressing support
+[PULL 47/54] target/arm: Use tcg_constant for vector descriptor
-From: "Edgar E. Iglesias" <edgar.iglesias@xilinx.com>
+From: Richard Henderson <richard.henderson@linaro.org>
-Announce 64bit addressing support.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Reviewed-by: Alistair Francis <alistair.francis@wdc.com>
 Signed-off-by: Edgar E. Iglesias <edgar.iglesias@xilinx.com>
 Message-id: 20181017213932.19973-3-edgar.iglesias@gmail.com
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20220426163043.100432-48-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- hw/net/cadence_gem.c | 3 ++-
+ target/arm/translate-sve.c | 54 ++++++++++----------------------------
-file changed, 2 insertions(+), 1 deletion(-)
+file changed, 14 insertions(+), 40 deletions(-)
-diff --git a/hw/net/cadence_gem.c b/hw/net/cadence_gem.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/hw/net/cadence_gem.c
+--- a/target/arm/translate-sve.c
-+++ b/hw/net/cadence_gem.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@
+@@ -XXX,XX +XXX,XX @@ static bool do_vpz_ool(DisasContext *s, arg_rpr_esz *a,
- #define GEM_DESCONF4      (0x0000028C/4)
+         return true;
- #define GEM_DESCONF5      (0x00000290/4)
+     }
- #define GEM_DESCONF6      (0x00000294/4)
-+#define GEM_DESCONF6_64B_MASK (1U << 23)
+-    desc = tcg_const_i32(simd_desc(vsz, vsz, 0));
- #define GEM_DESCONF7      (0x00000298/4)
++    desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
+     temp = tcg_temp_new_i64();
- #define GEM_INT_Q1_STATUS               (0x00000400 / 4)
+     t_zn = tcg_temp_new_ptr();
-@@ -XXX,XX +XXX,XX @@ static void gem_reset(DeviceState *d)
+     t_pg = tcg_temp_new_ptr();
-     s->regs[GEM_DESCONF] = 0x02500111;
+@@ -XXX,XX +XXX,XX @@ static bool do_vpz_ool(DisasContext *s, arg_rpr_esz *a,
-     s->regs[GEM_DESCONF2] = 0x2ab13fff;
+     fn(temp, t_zn, t_pg, desc);
-     s->regs[GEM_DESCONF5] = 0x002f2045;
+     tcg_temp_free_ptr(t_zn);
--    s->regs[GEM_DESCONF6] = 0x0;
+     tcg_temp_free_ptr(t_pg);
-+    s->regs[GEM_DESCONF6] = GEM_DESCONF6_64B_MASK;
+-    tcg_temp_free_i32(desc);
-     if (s->num_priority_queues > 1) {
+     write_fp_dreg(s, a->rd, temp);
-         queues_mask = MAKE_64BIT_MASK(1, s->num_priority_queues - 1);
+     tcg_temp_free_i64(temp);
@@ -XXX,XX +XXX,XX @@ static void do_index(DisasContext *s, int esz, int rd,
                       TCGv_i64 start, TCGv_i64 incr)
  {
      unsigned vsz = vec_full_reg_size(s);
 -    TCGv_i32 desc = tcg_const_i32(simd_desc(vsz, vsz, 0));
 +    TCGv_i32 desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
      TCGv_ptr t_zd = tcg_temp_new_ptr();
      tcg_gen_addi_ptr(t_zd, cpu_env, vec_full_reg_offset(s, rd));
@@ -XXX,XX +XXX,XX @@ static void do_index(DisasContext *s, int esz, int rd,
          tcg_temp_free_i32(i32);
      }
      tcg_temp_free_ptr(t_zd);
 -    tcg_temp_free_i32(desc);
  }
  static bool trans_INDEX_ii(DisasContext *s, arg_INDEX_ii *a)
@@ -XXX,XX +XXX,XX @@ static void do_sat_addsub_vec(DisasContext *s, int esz, int rd, int rn,
      nptr = tcg_temp_new_ptr();
      tcg_gen_addi_ptr(dptr, cpu_env, vec_full_reg_offset(s, rd));
      tcg_gen_addi_ptr(nptr, cpu_env, vec_full_reg_offset(s, rn));
 -    desc = tcg_const_i32(simd_desc(vsz, vsz, 0));
 +    desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
      switch (esz) {
      case MO_8:
@@ -XXX,XX +XXX,XX @@ static void do_sat_addsub_vec(DisasContext *s, int esz, int rd, int rn,
      tcg_temp_free_ptr(dptr);
      tcg_temp_free_ptr(nptr);
 -    tcg_temp_free_i32(desc);
  }
  static bool trans_CNT_r(DisasContext *s, arg_CNT_r *a)
@@ -XXX,XX +XXX,XX @@ static void do_cpy_m(DisasContext *s, int esz, int rd, int rn, int pg,
          gen_helper_sve_cpy_m_s, gen_helper_sve_cpy_m_d,
      };
      unsigned vsz = vec_full_reg_size(s);
 -    TCGv_i32 desc = tcg_const_i32(simd_desc(vsz, vsz, 0));
 +    TCGv_i32 desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
      TCGv_ptr t_zd = tcg_temp_new_ptr();
      TCGv_ptr t_zn = tcg_temp_new_ptr();
      TCGv_ptr t_pg = tcg_temp_new_ptr();
@@ -XXX,XX +XXX,XX @@ static void do_cpy_m(DisasContext *s, int esz, int rd, int rn, int pg,
      tcg_temp_free_ptr(t_zd);
      tcg_temp_free_ptr(t_zn);
      tcg_temp_free_ptr(t_pg);
 -    tcg_temp_free_i32(desc);
  }
  static bool trans_FCPY(DisasContext *s, arg_FCPY *a)
@@ -XXX,XX +XXX,XX @@ static void do_insr_i64(DisasContext *s, arg_rrr_esz *a, TCGv_i64 val)
          gen_helper_sve_insr_s, gen_helper_sve_insr_d,
      };
      unsigned vsz = vec_full_reg_size(s);
 -    TCGv_i32 desc = tcg_const_i32(simd_desc(vsz, vsz, 0));
 +    TCGv_i32 desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
      TCGv_ptr t_zd = tcg_temp_new_ptr();
      TCGv_ptr t_zn = tcg_temp_new_ptr();
@@ -XXX,XX +XXX,XX @@ static void do_insr_i64(DisasContext *s, arg_rrr_esz *a, TCGv_i64 val)
      tcg_temp_free_ptr(t_zd);
      tcg_temp_free_ptr(t_zn);
 -    tcg_temp_free_i32(desc);
  }
  static bool trans_INSR_f(DisasContext *s, arg_rrr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool do_perm_pred3(DisasContext *s, arg_rrr_esz *a, bool high_odd,
      TCGv_ptr t_d = tcg_temp_new_ptr();
      TCGv_ptr t_n = tcg_temp_new_ptr();
      TCGv_ptr t_m = tcg_temp_new_ptr();
 -    TCGv_i32 t_desc;
      uint32_t desc = 0;
      desc = FIELD_DP32(desc, PREDDESC, OPRSZ, vsz);
@@ -XXX,XX +XXX,XX @@ static bool do_perm_pred3(DisasContext *s, arg_rrr_esz *a, bool high_odd,
      tcg_gen_addi_ptr(t_d, cpu_env, pred_full_reg_offset(s, a->rd));
      tcg_gen_addi_ptr(t_n, cpu_env, pred_full_reg_offset(s, a->rn));
      tcg_gen_addi_ptr(t_m, cpu_env, pred_full_reg_offset(s, a->rm));
 -    t_desc = tcg_const_i32(desc);
 -    fn(t_d, t_n, t_m, t_desc);
 +    fn(t_d, t_n, t_m, tcg_constant_i32(desc));
      tcg_temp_free_ptr(t_d);
      tcg_temp_free_ptr(t_n);
      tcg_temp_free_ptr(t_m);
 -    tcg_temp_free_i32(t_desc);
      return true;
  }
@@ -XXX,XX +XXX,XX @@ static bool do_perm_pred2(DisasContext *s, arg_rr_esz *a, bool high_odd,
      unsigned vsz = pred_full_reg_size(s);
      TCGv_ptr t_d = tcg_temp_new_ptr();
      TCGv_ptr t_n = tcg_temp_new_ptr();
 -    TCGv_i32 t_desc;
      uint32_t desc = 0;
      tcg_gen_addi_ptr(t_d, cpu_env, pred_full_reg_offset(s, a->rd));
@@ -XXX,XX +XXX,XX @@ static bool do_perm_pred2(DisasContext *s, arg_rr_esz *a, bool high_odd,
      desc = FIELD_DP32(desc, PREDDESC, OPRSZ, vsz);
      desc = FIELD_DP32(desc, PREDDESC, ESZ, a->esz);
      desc = FIELD_DP32(desc, PREDDESC, DATA, high_odd);
 -    t_desc = tcg_const_i32(desc);
 -    fn(t_d, t_n, t_desc);
 +    fn(t_d, t_n, tcg_constant_i32(desc));
 -    tcg_temp_free_i32(t_desc);
      tcg_temp_free_ptr(t_d);
      tcg_temp_free_ptr(t_n);
      return true;
@@ -XXX,XX +XXX,XX @@ static void find_last_active(DisasContext *s, TCGv_i32 ret, int esz, int pg)
       * round up, as we do elsewhere, because we need the exact size.
       */
      TCGv_ptr t_p = tcg_temp_new_ptr();
 -    TCGv_i32 t_desc;
      unsigned desc = 0;
      desc = FIELD_DP32(desc, PREDDESC, OPRSZ, pred_full_reg_size(s));
      desc = FIELD_DP32(desc, PREDDESC, ESZ, esz);
      tcg_gen_addi_ptr(t_p, cpu_env, pred_full_reg_offset(s, pg));
 -    t_desc = tcg_const_i32(desc);
 -    gen_helper_sve_last_active_element(ret, t_p, t_desc);
 +    gen_helper_sve_last_active_element(ret, t_p, tcg_constant_i32(desc));
 -    tcg_temp_free_i32(t_desc);
      tcg_temp_free_ptr(t_p);
  }
@@ -XXX,XX +XXX,XX @@ static void do_cntp(DisasContext *s, TCGv_i64 val, int esz, int pn, int pg)
          TCGv_ptr t_pn = tcg_temp_new_ptr();
          TCGv_ptr t_pg = tcg_temp_new_ptr();
          unsigned desc = 0;
 -        TCGv_i32 t_desc;
          desc = FIELD_DP32(desc, PREDDESC, OPRSZ, psz);
          desc = FIELD_DP32(desc, PREDDESC, ESZ, esz);
          tcg_gen_addi_ptr(t_pn, cpu_env, pred_full_reg_offset(s, pn));
          tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, pg));
 -        t_desc = tcg_const_i32(desc);
 -        gen_helper_sve_cntp(val, t_pn, t_pg, t_desc);
 +        gen_helper_sve_cntp(val, t_pn, t_pg, tcg_constant_i32(desc));
          tcg_temp_free_ptr(t_pn);
          tcg_temp_free_ptr(t_pg);
 -        tcg_temp_free_i32(t_desc);
      }
  }
@@ -XXX,XX +XXX,XX @@ static void do_reduce(DisasContext *s, arg_rpr_esz *a,
  {
      unsigned vsz = vec_full_reg_size(s);
      unsigned p2vsz = pow2ceil(vsz);
 -    TCGv_i32 t_desc = tcg_const_i32(simd_desc(vsz, vsz, p2vsz));
 +    TCGv_i32 t_desc = tcg_constant_i32(simd_desc(vsz, vsz, p2vsz));
      TCGv_ptr t_zn, t_pg, status;
      TCGv_i64 temp;
@@ -XXX,XX +XXX,XX @@ static void do_reduce(DisasContext *s, arg_rpr_esz *a,
      tcg_temp_free_ptr(t_zn);
      tcg_temp_free_ptr(t_pg);
      tcg_temp_free_ptr(status);
 -    tcg_temp_free_i32(t_desc);
      write_fp_dreg(s, a->rd, temp);
      tcg_temp_free_i64(temp);
@@ -XXX,XX +XXX,XX @@ static bool trans_FADDA(DisasContext *s, arg_rprr_esz *a)
      tcg_gen_addi_ptr(t_rm, cpu_env, vec_full_reg_offset(s, a->rm));
      tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, a->pg));
      t_fpst = fpstatus_ptr(a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
 -    t_desc = tcg_const_i32(simd_desc(vsz, vsz, 0));
 +    t_desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
      fns[a->esz - 1](t_val, t_val, t_rm, t_pg, t_fpst, t_desc);
 -    tcg_temp_free_i32(t_desc);
      tcg_temp_free_ptr(t_fpst);
      tcg_temp_free_ptr(t_pg);
      tcg_temp_free_ptr(t_rm);
@@ -XXX,XX +XXX,XX @@ static void do_fp_scalar(DisasContext *s, int zd, int zn, int pg, bool is_fp16,
      tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, pg));
      status = fpstatus_ptr(is_fp16 ? FPST_FPCR_F16 : FPST_FPCR);
 -    desc = tcg_const_i32(simd_desc(vsz, vsz, 0));
 +    desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
      fn(t_zd, t_zn, t_pg, scalar, status, desc);
 -    tcg_temp_free_i32(desc);
      tcg_temp_free_ptr(status);
      tcg_temp_free_ptr(t_pg);
      tcg_temp_free_ptr(t_zn);
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
  {
      unsigned vsz = vec_full_reg_size(s);
      TCGv_ptr t_pg;
 -    TCGv_i32 t_desc;
      int desc = 0;
      /*
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
      }
      desc = simd_desc(vsz, vsz, zt | desc);
 -    t_desc = tcg_const_i32(desc);
      t_pg = tcg_temp_new_ptr();
      tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, pg));
 -    fn(cpu_env, t_pg, addr, t_desc);
 +    fn(cpu_env, t_pg, addr, tcg_constant_i32(desc));
      tcg_temp_free_ptr(t_pg);
 -    tcg_temp_free_i32(t_desc);
  }
  /* Indexed by [mte][be][dtype][nreg] */
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpz(DisasContext *s, int zt, int pg, int zm,
      TCGv_ptr t_zm = tcg_temp_new_ptr();
      TCGv_ptr t_pg = tcg_temp_new_ptr();
      TCGv_ptr t_zt = tcg_temp_new_ptr();
 -    TCGv_i32 t_desc;
      int desc = 0;
      if (s->mte_active[0]) {
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpz(DisasContext *s, int zt, int pg, int zm,
          desc <<= SVE_MTEDESC_SHIFT;
      }
      desc = simd_desc(vsz, vsz, desc | scale);
 -    t_desc = tcg_const_i32(desc);
      tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, pg));
      tcg_gen_addi_ptr(t_zm, cpu_env, vec_full_reg_offset(s, zm));
      tcg_gen_addi_ptr(t_zt, cpu_env, vec_full_reg_offset(s, zt));
 -    fn(cpu_env, t_zt, t_pg, t_zm, scalar, t_desc);
 +    fn(cpu_env, t_zt, t_pg, t_zm, scalar, tcg_constant_i32(desc));
      tcg_temp_free_ptr(t_zt);
      tcg_temp_free_ptr(t_zm);
      tcg_temp_free_ptr(t_pg);
 -    tcg_temp_free_i32(t_desc);
  }
  /* Indexed by [mte][be][ff][xs][u][msz].  */
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 04/45] target/arm: V8M should not imply V7VE
+[PULL 48/54] target/arm: Disable cryptographic instructions when neon is disabled
-From: Richard Henderson <richard.henderson@linaro.org>
+From: Damien Hedde <damien.hedde@greensocs.com>
-Instantiating mps2-an505 (cortex-m33) will fail make check when
+As of now, cryptographic instructions ISAR fields are never cleared so
-V7VE asserts that ID_ISAR0.Divide includes ARM division.  It is
+we can end up with a cpu with cryptographic instructions but no
-also wrong to include ARM_FEATURE_LPAE.
+floating-point/neon instructions which is not a possible configuration
 according to Arm specifications.
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+In QEMU, we have 3 kinds of cpus regarding cryptographic instructions:
-Message-id: 20181016223115.24100-3-richard.henderson@linaro.org
++ no support
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
++ cortex-a57/a72: cryptographic extension is optional,
   floating-point/neon is not.
 + cortex-a53: crytographic extension is optional as well as
   floating-point/neon. But cryptographic requires
   floating-point/neon support.
 Therefore we can safely clear the ISAR fields when neon is disabled.
 Note that other Arm cpus seem to follow this. For example cortex-a55 is
 like cortex-a53 and cortex-a76/cortex-a710 are like cortex-a57/a72.
 Signed-off-by: Damien Hedde <damien.hedde@greensocs.com>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20220427090117.6954-1-damien.hedde@greensocs.com
 [PMM: fixed commit message typos]
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.c | 6 +++++-
+ target/arm/cpu.c | 9 +++++++++
-file changed, 5 insertions(+), 1 deletion(-)
+file changed, 9 insertions(+)
 diff --git a/target/arm/cpu.c b/target/arm/cpu.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu.c
 +++ b/target/arm/cpu.c
 @@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
+         unset_feature(env, ARM_FEATURE_NEON);
-     /* Some features automatically imply others: */
-     if (arm_feature(env, ARM_FEATURE_V8)) {
+         t = cpu->isar.id_aa64isar0;
--        set_feature(env, ARM_FEATURE_V7VE);
++        t = FIELD_DP64(t, ID_AA64ISAR0, AES, 0);
-+        if (arm_feature(env, ARM_FEATURE_M)) {
++        t = FIELD_DP64(t, ID_AA64ISAR0, SHA1, 0);
-+            set_feature(env, ARM_FEATURE_V7);
++        t = FIELD_DP64(t, ID_AA64ISAR0, SHA2, 0);
-+        } else {
++        t = FIELD_DP64(t, ID_AA64ISAR0, SHA3, 0);
-+            set_feature(env, ARM_FEATURE_V7VE);
++        t = FIELD_DP64(t, ID_AA64ISAR0, SM3, 0);
-+        }
++        t = FIELD_DP64(t, ID_AA64ISAR0, SM4, 0);
-     }
+         t = FIELD_DP64(t, ID_AA64ISAR0, DP, 0);
-     if (arm_feature(env, ARM_FEATURE_V7VE)) {
+         cpu->isar.id_aa64isar0 = t;
-         /* v7 Virtualization Extensions. In real hardware this implies
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
          cpu->isar.id_aa64pfr0 = t;
          u = cpu->isar.id_isar5;
 +        u = FIELD_DP32(u, ID_ISAR5, AES, 0);
 +        u = FIELD_DP32(u, ID_ISAR5, SHA1, 0);
 +        u = FIELD_DP32(u, ID_ISAR5, SHA2, 0);
          u = FIELD_DP32(u, ID_ISAR5, RDM, 0);
          u = FIELD_DP32(u, ID_ISAR5, VCMA, 0);
          cpu->isar.id_isar5 = u;
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 18/45] target/arm: New utility function to extract EC from syndrome
+[PULL 49/54] target/arm: Use field names for accessing DBGWCRn
-Create and use a utility function to extract the EC field
+From: Richard Henderson <richard.henderson@linaro.org>
 from a syndrome, rather than open-coding the shift.
+While defining these names, use the correct field width of 5 not 4 for
+DBGWCR.MASK.  This typo prevented setting a watchpoint larger than 32k.
+Reported-by: Chris Howard <cvz185@web.de>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Alex Bennée <alex.bennee@linaro.org>
+Message-id: 20220427051926.295223-1-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181012144235.19646-9-peter.maydell@linaro.org
 ---
- target/arm/internals.h | 5 +++++
+ target/arm/internals.h    | 12 ++++++++++++
- target/arm/helper.c    | 4 ++--
+ target/arm/debug_helper.c | 10 +++++-----
- target/arm/kvm64.c     | 2 +-
+ target/arm/helper.c       |  8 ++++----
- target/arm/op_helper.c | 2 +-
+ target/arm/kvm64.c        | 14 +++++++-------
-files changed, 9 insertions(+), 4 deletions(-)
+files changed, 28 insertions(+), 16 deletions(-)
 diff --git a/target/arm/internals.h b/target/arm/internals.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/internals.h
 +++ b/target/arm/internals.h
-@@ -XXX,XX +XXX,XX @@ enum arm_exception_class {
+@@ -XXX,XX +XXX,XX @@ FIELD(V7M_EXCRET, RES1, 7, 25) /* including the must-be-1 prefix */
- #define ARM_EL_IL (1 << ARM_EL_IL_SHIFT)
+  */
- #define ARM_EL_ISV (1 << ARM_EL_ISV_SHIFT)
+ #define FNC_RETURN_MIN_MAGIC 0xfefffffe
-+static inline uint32_t syn_get_ec(uint32_t syn)
++/* Bit definitions for DBGWCRn and DBGWCRn_EL1 */
-+{
++FIELD(DBGWCR, E, 0, 1)
-+    return syn >> ARM_EL_EC_SHIFT;
++FIELD(DBGWCR, PAC, 1, 2)
-+}
++FIELD(DBGWCR, LSC, 3, 2)
 +FIELD(DBGWCR, BAS, 5, 8)
 +FIELD(DBGWCR, HMC, 13, 1)
 +FIELD(DBGWCR, SSC, 14, 2)
 +FIELD(DBGWCR, LBN, 16, 4)
 +FIELD(DBGWCR, WT, 20, 1)
 +FIELD(DBGWCR, MASK, 24, 5)
 +FIELD(DBGWCR, SSCE, 29, 1)
 +
- /* Utility functions for constructing various kinds of syndrome value.
+ /* We use a few fake FSR values for internal purposes in M profile.
-  * Note that in general we follow the AArch64 syndrome values; in a
+  * M profile cores don't have A/R format FSRs, but currently our
-  * few cases the value in HSR for exceptions taken to AArch32 Hyp
+  * get_phys_addr() code assumes A/R profile and reports failures via
 diff --git a/target/arm/debug_helper.c b/target/arm/debug_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/debug_helper.c
 +++ b/target/arm/debug_helper.c
@@ -XXX,XX +XXX,XX @@ static bool bp_wp_matches(ARMCPU *cpu, int n, bool is_wp)
       * Non-Secure to simplify the code slightly compared to the full
       * table in the ARM ARM.
       */
 -    pac = extract64(cr, 1, 2);
 -    hmc = extract64(cr, 13, 1);
 -    ssc = extract64(cr, 14, 2);
 +    pac = FIELD_EX64(cr, DBGWCR, PAC);
 +    hmc = FIELD_EX64(cr, DBGWCR, HMC);
 +    ssc = FIELD_EX64(cr, DBGWCR, SSC);
      switch (ssc) {
      case 0:
@@ -XXX,XX +XXX,XX @@ static bool bp_wp_matches(ARMCPU *cpu, int n, bool is_wp)
          g_assert_not_reached();
      }
 -    wt = extract64(cr, 20, 1);
 -    lbn = extract64(cr, 16, 4);
 +    wt = FIELD_EX64(cr, DBGWCR, WT);
 +    lbn = FIELD_EX64(cr, DBGWCR, LBN);
      if (wt && !linked_bp_matches(cpu, lbn)) {
          return false;
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ static void arm_cpu_do_interrupt_aarch32(CPUState *cs)
+@@ -XXX,XX +XXX,XX @@ void hw_watchpoint_update(ARMCPU *cpu, int n)
-     uint32_t moe;
+         env->cpu_watchpoint[n] = NULL;
      /* If this is a debug exception we must update the DBGDSCR.MOE bits */
 -    switch (env->exception.syndrome >> ARM_EL_EC_SHIFT) {
 +    switch (syn_get_ec(env->exception.syndrome)) {
      case EC_BREAKPOINT:
      case EC_BREAKPOINT_SAME_EL:
          moe = 1;
@@ -XXX,XX +XXX,XX @@ void arm_cpu_do_interrupt(CPUState *cs)
      if (qemu_loglevel_mask(CPU_LOG_INT)
          && !excp_is_internal(cs->exception_index)) {
          qemu_log_mask(CPU_LOG_INT, "...with ESR 0x%x/0x%" PRIx32 "\n",
 -                      env->exception.syndrome >> ARM_EL_EC_SHIFT,
 +                      syn_get_ec(env->exception.syndrome),
                        env->exception.syndrome);
      }
+-    if (!extract64(wcr, 0, 1)) {
++    if (!FIELD_EX64(wcr, DBGWCR, E)) {
+         /* E bit clear : watchpoint disabled */
+         return;
+     }
+-    switch (extract64(wcr, 3, 2)) {
++    switch (FIELD_EX64(wcr, DBGWCR, LSC)) {
+     case 0:
+         /* LSC 00 is reserved and must behave as if the wp is disabled */
+         return;
+@@ -XXX,XX +XXX,XX @@ void hw_watchpoint_update(ARMCPU *cpu, int n)
+      * CONSTRAINED UNPREDICTABLE; we opt to ignore BAS in this case,
+      * thus generating a watchpoint for every byte in the masked region.
+      */
+-    mask = extract64(wcr, 24, 4);
++    mask = FIELD_EX64(wcr, DBGWCR, MASK);
+     if (mask == 1 || mask == 2) {
+         /* Reserved values of MASK; we must act as if the mask value was
+          * some non-reserved value, or as if the watchpoint were disabled.
+@@ -XXX,XX +XXX,XX @@ void hw_watchpoint_update(ARMCPU *cpu, int n)
+         wvr &= ~(len - 1);
+     } else {
+         /* Watchpoint covers bytes defined by the byte address select bits */
+-        int bas = extract64(wcr, 5, 8);
++        int bas = FIELD_EX64(wcr, DBGWCR, BAS);
+         int basstart;
+         if (extract64(wvr, 2, 1)) {
 diff --git a/target/arm/kvm64.c b/target/arm/kvm64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/kvm64.c
 +++ b/target/arm/kvm64.c
-@@ -XXX,XX +XXX,XX @@ int kvm_arch_remove_sw_breakpoint(CPUState *cs, struct kvm_sw_breakpoint *bp)
+@@ -XXX,XX +XXX,XX @@ static int insert_hw_watchpoint(target_ulong addr,
+                                 target_ulong len, int type)
  bool kvm_arm_handle_debug(CPUState *cs, struct kvm_debug_exit_arch *debug_exit)
  {
--    int hsr_ec = debug_exit->hsr >> ARM_EL_EC_SHIFT;
+     HWWatchpoint wp = {
-+    int hsr_ec = syn_get_ec(debug_exit->hsr);
+-        .wcr = 1, /* E=1, enable */
-     ARMCPU *cpu = ARM_CPU(cs);
++        .wcr = R_DBGWCR_E_MASK, /* E=1, enable */
-     CPUClass *cc = CPU_GET_CLASS(cs);
+         .wvr = addr & (~0x7ULL),
-     CPUARMState *env = &cpu->env;
+         .details = { .vaddr = addr, .len = len }
-diff --git a/target/arm/op_helper.c b/target/arm/op_helper.c
+     };
-index XXXXXXX..XXXXXXX 100644
+@@ -XXX,XX +XXX,XX @@ static int insert_hw_watchpoint(target_ulong addr,
---- a/target/arm/op_helper.c
+      * HMC=0 SSC=0 PAC=3 will hit EL0 or EL1, any security state,
-+++ b/target/arm/op_helper.c
+      * valid whether EL3 is implemented or not
-@@ -XXX,XX +XXX,XX @@ void raise_exception(CPUARMState *env, uint32_t excp,
+      */
-          * (see DDI0478C.a D1.10.4)
+-    wp.wcr = deposit32(wp.wcr, 1, 2, 3);
-          */
++    wp.wcr = FIELD_DP64(wp.wcr, DBGWCR, PAC, 3);
-         target_el = 2;
--        if (syndrome >> ARM_EL_EC_SHIFT == EC_ADVSIMDFPACCESSTRAP) {
+     switch (type) {
-+        if (syn_get_ec(syndrome) == EC_ADVSIMDFPACCESSTRAP) {
+     case GDB_WATCHPOINT_READ:
-             syndrome = syn_uncategorized();
+-        wp.wcr = deposit32(wp.wcr, 3, 2, 1);
 +        wp.wcr = FIELD_DP64(wp.wcr, DBGWCR, LSC, 1);
          wp.details.flags = BP_MEM_READ;
          break;
      case GDB_WATCHPOINT_WRITE:
 -        wp.wcr = deposit32(wp.wcr, 3, 2, 2);
 +        wp.wcr = FIELD_DP64(wp.wcr, DBGWCR, LSC, 2);
          wp.details.flags = BP_MEM_WRITE;
          break;
      case GDB_WATCHPOINT_ACCESS:
 -        wp.wcr = deposit32(wp.wcr, 3, 2, 3);
 +        wp.wcr = FIELD_DP64(wp.wcr, DBGWCR, LSC, 3);
          wp.details.flags = BP_MEM_ACCESS;
          break;
      default:
@@ -XXX,XX +XXX,XX @@ static int insert_hw_watchpoint(target_ulong addr,
              int bits = ctz64(len);
              wp.wvr &= ~((1 << bits) - 1);
 -            wp.wcr = deposit32(wp.wcr, 24, 4, bits);
 -            wp.wcr = deposit32(wp.wcr, 5, 8, 0xff);
 +            wp.wcr = FIELD_DP64(wp.wcr, DBGWCR, MASK, bits);
 +            wp.wcr = FIELD_DP64(wp.wcr, DBGWCR, BAS, 0xff);
          } else {
              return -ENOBUFS;
          }
-     }
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 19/45] target/arm: Get IL bit correct for v7 syndrome values
+[PULL 50/54] hw/arm/smmuv3: Cache event fault record
-For the v7 version of the Arm architecture, the IL bit in
+From: Jean-Philippe Brucker <jean-philippe@linaro.org>
 syndrome register values where the field is not valid was
 defined to be UNK/SBZP. In v8 this is RES1, which is what
 QEMU currently implements. Handle the desired v7 behaviour
 by squashing the IL bit for the affected cases:
  * EC == EC_UNCATEGORIZED
  * prefetch aborts
  * data aborts where ISV is 0
-(The fourth case listed in the v8 Arm ARM DDI 0487C.a in
+The Record bit in the Context Descriptor tells the SMMU to report fault
-section G7.2.70, "illegal state exception", can't happen
+events to the event queue. Since we don't cache the Record bit at the
-on a v7 CPU.)
+moment, access faults from a cached Context Descriptor are never
 reported. Store the Record bit in the cached SMMUTransCfg.
-This deals with a corner case noted in a comment.
+Fixes: 9bde7f0674fe ("hw/arm/smmuv3: Implement translate callback")
 Signed-off-by: Jean-Philippe Brucker <jean-philippe@linaro.org>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Reviewed-by: Eric Auger <eric.auger@redhat.com>
 Message-id: 20220427111543.124620-1-jean-philippe@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  hw/arm/smmuv3-internal.h     |  1 -
  include/hw/arm/smmu-common.h |  1 +
  hw/arm/smmuv3.c              | 14 +++++++-------
 files changed, 8 insertions(+), 8 deletions(-)
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+diff --git a/hw/arm/smmuv3-internal.h b/hw/arm/smmuv3-internal.h
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20181012144235.19646-10-peter.maydell@linaro.org
 ---
  target/arm/internals.h |  7 ++-----
  target/arm/helper.c    | 13 +++++++++++++
 files changed, 15 insertions(+), 5 deletions(-)
 diff --git a/target/arm/internals.h b/target/arm/internals.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/internals.h
+--- a/hw/arm/smmuv3-internal.h
-+++ b/target/arm/internals.h
++++ b/hw/arm/smmuv3-internal.h
-@@ -XXX,XX +XXX,XX @@ static inline uint32_t syn_get_ec(uint32_t syn)
+@@ -XXX,XX +XXX,XX @@ typedef struct SMMUEventInfo {
- /* Utility functions for constructing various kinds of syndrome value.
+     SMMUEventType type;
-  * Note that in general we follow the AArch64 syndrome values; in a
+     uint32_t sid;
-  * few cases the value in HSR for exceptions taken to AArch32 Hyp
+     bool recorded;
-- * mode differs slightly, so if we ever implemented Hyp mode then the
+-    bool record_trans_faults;
-- * syndrome value would need some massaging on exception entry.
+     bool inval_ste_allowed;
-- * (One example of this is that AArch64 defaults to IL bit set for
+     union {
-- * exceptions which don't specifically indicate information about the
+         struct {
-- * trapping instruction, whereas AArch32 defaults to IL bit clear.)
+diff --git a/include/hw/arm/smmu-common.h b/include/hw/arm/smmu-common.h
 + * mode differs slightly, and we fix this up when populating HSR in
 + * arm_cpu_do_interrupt_aarch32_hyp().
   */
  static inline uint32_t syn_uncategorized(void)
  {
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/include/hw/arm/smmu-common.h
-+++ b/target/arm/helper.c
++++ b/include/hw/arm/smmu-common.h
-@@ -XXX,XX +XXX,XX @@ static void arm_cpu_do_interrupt_aarch32_hyp(CPUState *cs)
+@@ -XXX,XX +XXX,XX @@ typedef struct SMMUTransCfg {
      bool disabled;             /* smmu is disabled */
      bool bypassed;             /* translation is bypassed */
      bool aborted;              /* translation is aborted */
 +    bool record_faults;        /* record fault events */
      uint64_t ttb;              /* TT base address */
      uint8_t oas;               /* output address width */
      uint8_t tbi;               /* Top Byte Ignore */
 diff --git a/hw/arm/smmuv3.c b/hw/arm/smmuv3.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/arm/smmuv3.c
 +++ b/hw/arm/smmuv3.c
@@ -XXX,XX +XXX,XX @@ static int decode_cd(SMMUTransCfg *cfg, CD *cd, SMMUEventInfo *event)
          trace_smmuv3_decode_cd_tt(i, tt->tsz, tt->ttb, tt->granule_sz, tt->had);
      }
-     if (cs->exception_index != EXCP_IRQ && cs->exception_index != EXCP_FIQ) {
+-    event->record_trans_faults = CD_R(cd);
-+        if (!arm_feature(env, ARM_FEATURE_V8)) {
++    cfg->record_faults = CD_R(cd);
-+            /*
-+             * QEMU syndrome values are v8-style. v7 has the IL bit
+     return 0;
-+             * UNK/SBZP for "field not valid" cases, where v8 uses RES1.
-+             * If this is a v7 CPU, squash the IL bit in those cases.
+@@ -XXX,XX +XXX,XX @@ static IOMMUTLBEntry smmuv3_translate(IOMMUMemoryRegion *mr, hwaddr addr,
-+             */
-+            if (cs->exception_index == EXCP_PREFETCH_ABORT ||
+     tt = select_tt(cfg, addr);
-+                (cs->exception_index == EXCP_DATA_ABORT &&
+     if (!tt) {
-+                 !(env->exception.syndrome & ARM_EL_ISV)) ||
+-        if (event.record_trans_faults) {
-+                syn_get_ec(env->exception.syndrome) == EC_UNCATEGORIZED) {
++        if (cfg->record_faults) {
-+                env->exception.syndrome &= ~ARM_EL_IL;
+             event.type = SMMU_EVT_F_TRANSLATION;
-+            }
+             event.u.f_translation.addr = addr;
-+        }
+             event.u.f_translation.rnw = flag & 0x1;
-         env->cp15.esr_el[2] = env->exception.syndrome;
+@@ -XXX,XX +XXX,XX @@ static IOMMUTLBEntry smmuv3_translate(IOMMUMemoryRegion *mr, hwaddr addr,
-     }
+     if (cached_entry) {
+         if ((flag & IOMMU_WO) && !(cached_entry->entry.perm & IOMMU_WO)) {
              status = SMMU_TRANS_ERROR;
 -            if (event.record_trans_faults) {
 +            if (cfg->record_faults) {
                  event.type = SMMU_EVT_F_PERMISSION;
                  event.u.f_permission.addr = addr;
                  event.u.f_permission.rnw = flag & 0x1;
@@ -XXX,XX +XXX,XX @@ static IOMMUTLBEntry smmuv3_translate(IOMMUMemoryRegion *mr, hwaddr addr,
              event.u.f_walk_eabt.addr2 = ptw_info.addr;
              break;
          case SMMU_PTW_ERR_TRANSLATION:
 -            if (event.record_trans_faults) {
 +            if (cfg->record_faults) {
                  event.type = SMMU_EVT_F_TRANSLATION;
                  event.u.f_translation.addr = addr;
                  event.u.f_translation.rnw = flag & 0x1;
              }
              break;
          case SMMU_PTW_ERR_ADDR_SIZE:
 -            if (event.record_trans_faults) {
 +            if (cfg->record_faults) {
                  event.type = SMMU_EVT_F_ADDR_SIZE;
                  event.u.f_addr_size.addr = addr;
                  event.u.f_addr_size.rnw = flag & 0x1;
              }
              break;
          case SMMU_PTW_ERR_ACCESS:
 -            if (event.record_trans_faults) {
 +            if (cfg->record_faults) {
                  event.type = SMMU_EVT_F_ACCESS;
                  event.u.f_access.addr = addr;
                  event.u.f_access.rnw = flag & 0x1;
              }
              break;
          case SMMU_PTW_ERR_PERMISSION:
 -            if (event.record_trans_faults) {
 +            if (cfg->record_faults) {
                  event.type = SMMU_EVT_F_PERMISSION;
                  event.u.f_permission.addr = addr;
                  event.u.f_permission.rnw = flag & 0x1;
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 42/45] net: cadence_gem: Announce availability of priority queues
+[PULL 51/54] hw/arm/smmuv3: Add space in guest error message
-From: "Edgar E. Iglesias" <edgar.iglesias@xilinx.com>
+From: Jean-Philippe Brucker <jean-philippe@linaro.org>
-Announce the availability of the various priority queues.
+Make the translation error message prettier by adding a missing space
-This fixes an issue where guest kernels would miss to
+before the parenthesis.
 configure secondary queues due to inproper feature bits.
-Signed-off-by: Edgar E. Iglesias <edgar.iglesias@xilinx.com>
+Signed-off-by: Jean-Philippe Brucker <jean-philippe@linaro.org>
-Message-id: 20181017213932.19973-2-edgar.iglesias@gmail.com
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Eric Auger <eric.auger@redhat.com>
 Message-id: 20220427111543.124620-2-jean-philippe@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- hw/net/cadence_gem.c | 8 +++++++-
+ hw/arm/smmuv3.c | 2 +-
-file changed, 7 insertions(+), 1 deletion(-)
+file changed, 1 insertion(+), 1 deletion(-)
-diff --git a/hw/net/cadence_gem.c b/hw/net/cadence_gem.c
+diff --git a/hw/arm/smmuv3.c b/hw/arm/smmuv3.c
 index XXXXXXX..XXXXXXX 100644
---- a/hw/net/cadence_gem.c
+--- a/hw/arm/smmuv3.c
-+++ b/hw/net/cadence_gem.c
++++ b/hw/arm/smmuv3.c
-@@ -XXX,XX +XXX,XX @@ static void gem_reset(DeviceState *d)
+@@ -XXX,XX +XXX,XX @@ epilogue:
-     int i;
+         break;
-     CadenceGEMState *s = CADENCE_GEM(d);
+     case SMMU_TRANS_ERROR:
-     const uint8_t *a;
+         qemu_log_mask(LOG_GUEST_ERROR,
-+    uint32_t queues_mask = 0;
+-                      "%s translation failed for iova=0x%"PRIx64"(%s)\n",
++                      "%s translation failed for iova=0x%"PRIx64" (%s)\n",
-     DB_PRINT("\n");
+                       mr->parent_obj.name, addr, smmu_event_string(event.type));
+         smmuv3_record_event(s, &event);
-@@ -XXX,XX +XXX,XX @@ static void gem_reset(DeviceState *d)
+         break;
      s->regs[GEM_DESCONF] = 0x02500111;
      s->regs[GEM_DESCONF2] = 0x2ab13fff;
      s->regs[GEM_DESCONF5] = 0x002f2045;
 -    s->regs[GEM_DESCONF6] = 0x00000200;
 +    s->regs[GEM_DESCONF6] = 0x0;
 +
 +    if (s->num_priority_queues > 1) {
 +        queues_mask = MAKE_64BIT_MASK(1, s->num_priority_queues - 1);
 +        s->regs[GEM_DESCONF6] |= queues_mask;
 +    }
      /* Set MAC address */
      a = &s->conf.macaddr.a[0];
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 16/45] target/arm: Implement HCR.VI and VF
+[PULL 52/54] target/arm: Advertise support for FEAT_TTL
-The HCR_EL2 VI and VF bits are supposed to track whether there is
+The Arm FEAT_TTL architectural feature allows the guest to provide an
-a pending virtual IRQ or virtual FIQ. For QEMU we store the
+optional hint in an AArch64 TLB invalidate operation about which
-pending VIRQ/VFIQ status in cs->interrupt_request, so this means:
+translation table level holds the leaf entry for the address being
- * if the register is read we must get these bit values from
+invalidated.  QEMU's TLB implementation doesn't need that hint, and
-   cs->interrupt_request
+we correctly ignore the (previously RES0) bits in TLB invalidate
- * if the register is written then we must write the bit
+operation values that are now used for the TTL field.  So we can
-   values back into cs->interrupt_request
+simply advertise support for it in our 'max' CPU.
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181012144235.19646-7-peter.maydell@linaro.org
+Message-id: 20220426160422.2353158-2-peter.maydell@linaro.org
 ---
- target/arm/helper.c | 47 +++++++++++++++++++++++++++++++++++++++++----
+ docs/system/arm/emulation.rst | 1 +
-file changed, 43 insertions(+), 4 deletions(-)
+ target/arm/cpu64.c            | 1 +
 files changed, 2 insertions(+)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+diff --git a/docs/system/arm/emulation.rst b/docs/system/arm/emulation.rst
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/docs/system/arm/emulation.rst
-+++ b/target/arm/helper.c
++++ b/docs/system/arm/emulation.rst
-@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo el3_no_el2_v8_cp_reginfo[] = {
+@@ -XXX,XX +XXX,XX @@ the following architecture extensions:
- static void hcr_write(CPUARMState *env, const ARMCPRegInfo *ri, uint64_t value)
+ - FEAT_TLBIOS (TLB invalidate instructions in Outer Shareable domain)
- {
+ - FEAT_TLBIRANGE (TLB invalidate range instructions)
-     ARMCPU *cpu = arm_env_get_cpu(env);
+ - FEAT_TTCNP (Translation table Common not private translations)
-+    CPUState *cs = ENV_GET_CPU(env);
++- FEAT_TTL (Translation Table Level)
-     uint64_t valid_mask = HCR_MASK;
+ - FEAT_TTST (Small translation tables)
+ - FEAT_UAO (Unprivileged Access Override control)
-     if (arm_feature(env, ARM_FEATURE_EL3)) {
+ - FEAT_VHE (Virtualization Host Extensions)
-@@ -XXX,XX +XXX,XX @@ static void hcr_write(CPUARMState *env, const ARMCPRegInfo *ri, uint64_t value)
+diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
-     /* Clear RES0 bits.  */
+index XXXXXXX..XXXXXXX 100644
-     value &= valid_mask;
+--- a/target/arm/cpu64.c
++++ b/target/arm/cpu64.c
-+    /*
+@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
-+     * VI and VF are kept in cs->interrupt_request. Modifying that
+     t = FIELD_DP64(t, ID_AA64MMFR2, CNP, 1); /* TTCNP */
-+     * requires that we have the iothread lock, which is done by
+     t = FIELD_DP64(t, ID_AA64MMFR2, ST, 1); /* TTST */
-+     * marking the reginfo structs as ARM_CP_IO.
+     t = FIELD_DP64(t, ID_AA64MMFR2, VARANGE, 1); /* FEAT_LVA */
-+     * Note that if a write to HCR pends a VIRQ or VFIQ it is never
++    t = FIELD_DP64(t, ID_AA64MMFR2, TTL, 1); /* FEAT_TTL */
-+     * possible for it to be taken immediately, because VIRQ and
+     cpu->isar.id_aa64mmfr2 = t;
-+     * VFIQ are masked unless running at EL0 or EL1, and HCR
-+     * can only be written at EL2.
+     t = cpu->isar.id_aa64zfr0;
 +     */
 +    g_assert(qemu_mutex_iothread_locked());
 +    if (value & HCR_VI) {
 +        cs->interrupt_request |= CPU_INTERRUPT_VIRQ;
 +    } else {
 +        cs->interrupt_request &= ~CPU_INTERRUPT_VIRQ;
 +    }
 +    if (value & HCR_VF) {
 +        cs->interrupt_request |= CPU_INTERRUPT_VFIQ;
 +    } else {
 +        cs->interrupt_request &= ~CPU_INTERRUPT_VFIQ;
 +    }
 +    value &= ~(HCR_VI | HCR_VF);
 +
      /* These bits change the MMU setup:
       * HCR_VM enables stage 2 translation
       * HCR_PTW forbids certain page-table setups
@@ -XXX,XX +XXX,XX @@ static void hcr_writelow(CPUARMState *env, const ARMCPRegInfo *ri,
      hcr_write(env, NULL, value);
  }
 +static uint64_t hcr_read(CPUARMState *env, const ARMCPRegInfo *ri)
 +{
 +    /* The VI and VF bits live in cs->interrupt_request */
 +    uint64_t ret = env->cp15.hcr_el2 & ~(HCR_VI | HCR_VF);
 +    CPUState *cs = ENV_GET_CPU(env);
 +
 +    if (cs->interrupt_request & CPU_INTERRUPT_VIRQ) {
 +        ret |= HCR_VI;
 +    }
 +    if (cs->interrupt_request & CPU_INTERRUPT_VFIQ) {
 +        ret |= HCR_VF;
 +    }
 +    return ret;
 +}
 +
  static const ARMCPRegInfo el2_cp_reginfo[] = {
      { .name = "HCR_EL2", .state = ARM_CP_STATE_AA64,
 +      .type = ARM_CP_IO,
        .opc0 = 3, .opc1 = 4, .crn = 1, .crm = 1, .opc2 = 0,
        .access = PL2_RW, .fieldoffset = offsetof(CPUARMState, cp15.hcr_el2),
 -      .writefn = hcr_write },
 +      .writefn = hcr_write, .readfn = hcr_read },
      { .name = "HCR", .state = ARM_CP_STATE_AA32,
 -      .type = ARM_CP_ALIAS,
 +      .type = ARM_CP_ALIAS | ARM_CP_IO,
        .cp = 15, .opc1 = 4, .crn = 1, .crm = 1, .opc2 = 0,
        .access = PL2_RW, .fieldoffset = offsetof(CPUARMState, cp15.hcr_el2),
 -      .writefn = hcr_writelow },
 +      .writefn = hcr_writelow, .readfn = hcr_read },
      { .name = "ELR_EL2", .state = ARM_CP_STATE_AA64,
        .type = ARM_CP_ALIAS,
        .opc0 = 3, .opc1 = 4, .crn = 4, .crm = 0, .opc2 = 1,
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo el2_cp_reginfo[] = {
  static const ARMCPRegInfo el2_v8_cp_reginfo[] = {
      { .name = "HCR2", .state = ARM_CP_STATE_AA32,
 -      .type = ARM_CP_ALIAS,
 +      .type = ARM_CP_ALIAS | ARM_CP_IO,
        .cp = 15, .opc1 = 4, .crn = 1, .crm = 1, .opc2 = 4,
        .access = PL2_RW,
        .fieldoffset = offsetofhigh32(CPUARMState, cp15.hcr_el2),
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 15/45] target/arm: ISR_EL1 bits track virtual interrupts if IMO/FMO set
+[PULL 53/54] target/arm: Advertise support for FEAT_BBM level 2
-The A/I/F bits in ISR_EL1 should track the virtual interrupt
+The description in the Arm ARM of the requirements of FEAT_BBM is
-status, not the physical interrupt status, if the associated
+admirably clear on the guarantees it provides software, but slightly
-HCR_EL2.AMO/IMO/FMO bit is set. Implement this, rather than
+more obscure on what that means for implementations.  The description
-always showing the physical interrupt status.
+of the equivalent SMMU feature in the SMMU specification (IHI0070D.b
 section 3.21.1) is perhaps a bit more detailed and includes some
 example valid implementation choices. (The SMMU version of this
 feature is slightly tighter than the CPU version: the CPU is permitted
 to raise TLB Conflict aborts in some situations that the SMMU may
 not. This doesn't matter for QEMU because we don't want to do TLB
 Conflict aborts anyway.)
-We don't currently implement anything to do with external
+The informal summary of FEAT_BBM is that it is about permitting an OS
-aborts, so this applies only to the I and F bits (though it
+to switch a range of memory between "covered by a huge page" and
-ought to be possible for the outer guest to present a virtual
+"covered by a sequence of normal pages" without having to engage in
-external abort to the inner guest, even if QEMU doesn't
+the 'break-before-make' dance that has traditionally been
-emulate physical external aborts, so there is missing
+necessary. The 'break-before-make' sequence is:
-functionality in this area).
  * replace the old translation table entry with an invalid entry
  * execute a DSB insn
  * execute a broadcast TLB invalidate insn
  * execute a DSB insn
  * write the new translation table entry
  * execute a DSB insn
 The point of this is to ensure that no TLB can simultaneously contain
 TLB entries for the old and the new entry, which would traditionally
 be UNPREDICTABLE (allowing the CPU to generate a TLB Conflict fault
 or to use a random mishmash of values from the old and the new
 entry).  FEAT_BBM level 2 says "for the specific case where the only
 thing that changed is the size of the block, the TLB is guaranteed
 not to do weird things even if there are multiple entries for an
 address", which means that software can now do:
  * replace old translation table entry with new entry
  * DSB
  * broadcast TLB invalidate
  * DSB
 As the SMMU spec notes, valid ways to do this include:
  * if there are multiple entries in the TLB for an address,
    choose one of them and use it, ignoring the others
  * if there are multiple entries in the TLB for an address,
    throw them all out and do a page table walk to get a new one
 QEMU's page table walk implementation for Arm CPUs already meets the
 requirements for FEAT_BBM level 2. When we cache an entry in our TCG
 TLB, we do so only for the specific (non-huge) page that the address
 is in, and there is no way for the TLB data structure to ever have
 more than one TLB entry for that page. (We handle huge pages only in
 that we track what part of the address space is covered by huge pages
 so that a TLB invalidate operation for an address in a huge page
 results in an invalidation of the whole TLB.) We ignore the Contiguous
 bit in page table entries, so we don't have to do anything for the
 parts of FEAT_BBM that deal with changis to the Contiguous bit.
 FEAT_BBM level 2 also requires that the nT bit in block descriptors
 must be ignored; since commit 39a1fd25287f5dece5 we do this.
 It's therefore safe for QEMU to advertise FEAT_BBM level 2 by
 setting ID_AA64MMFR2_EL1.BBM to 2.
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181012144235.19646-6-peter.maydell@linaro.org
+Message-id: 20220426160422.2353158-3-peter.maydell@linaro.org
 ---
- target/arm/helper.c | 22 ++++++++++++++++++----
+ docs/system/arm/emulation.rst | 1 +
-file changed, 18 insertions(+), 4 deletions(-)
+ target/arm/cpu64.c            | 1 +
 files changed, 2 insertions(+)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+diff --git a/docs/system/arm/emulation.rst b/docs/system/arm/emulation.rst
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/docs/system/arm/emulation.rst
-+++ b/target/arm/helper.c
++++ b/docs/system/arm/emulation.rst
-@@ -XXX,XX +XXX,XX @@ static uint64_t isr_read(CPUARMState *env, const ARMCPRegInfo *ri)
+@@ -XXX,XX +XXX,XX @@ the following architecture extensions:
-     CPUState *cs = ENV_GET_CPU(env);
+ - FEAT_AA32HPD (AArch32 hierarchical permission disables)
-     uint64_t ret = 0;
+ - FEAT_AA32I8MM (AArch32 Int8 matrix multiplication instructions)
+ - FEAT_AES (AESD and AESE instructions)
--    if (cs->interrupt_request & CPU_INTERRUPT_HARD) {
++- FEAT_BBM at level 2 (Translation table break-before-make levels)
--        ret |= CPSR_I;
+ - FEAT_BF16 (AArch64 BFloat16 instructions)
-+    if (arm_hcr_el2_imo(env)) {
+ - FEAT_BTI (Branch Target Identification)
-+        if (cs->interrupt_request & CPU_INTERRUPT_VIRQ) {
+ - FEAT_DIT (Data Independent Timing instructions)
-+            ret |= CPSR_I;
+diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
-+        }
+index XXXXXXX..XXXXXXX 100644
-+    } else {
+--- a/target/arm/cpu64.c
-+        if (cs->interrupt_request & CPU_INTERRUPT_HARD) {
++++ b/target/arm/cpu64.c
-+            ret |= CPSR_I;
+@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
-+        }
+     t = FIELD_DP64(t, ID_AA64MMFR2, ST, 1); /* TTST */
-     }
+     t = FIELD_DP64(t, ID_AA64MMFR2, VARANGE, 1); /* FEAT_LVA */
--    if (cs->interrupt_request & CPU_INTERRUPT_FIQ) {
+     t = FIELD_DP64(t, ID_AA64MMFR2, TTL, 1); /* FEAT_TTL */
--        ret |= CPSR_F;
++    t = FIELD_DP64(t, ID_AA64MMFR2, BBM, 2); /* FEAT_BBM at level 2 */
-+
+     cpu->isar.id_aa64mmfr2 = t;
-+    if (arm_hcr_el2_fmo(env)) {
-+        if (cs->interrupt_request & CPU_INTERRUPT_VFIQ) {
+     t = cpu->isar.id_aa64zfr0;
 +            ret |= CPSR_F;
 +        }
 +    } else {
 +        if (cs->interrupt_request & CPU_INTERRUPT_FIQ) {
 +            ret |= CPSR_F;
 +        }
      }
 +
      /* External aborts are not possible in QEMU so A bit is always clear */
      return ret;
  }
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 17/45] target/arm: Implement HCR.PTW
+[PULL 54/54] hw/arm/smmuv3: Advertise support for SMMUv3.2-BBML2
-If the HCR_EL2 PTW virtualizaiton configuration register bit
+The Arm SMMUv3 includes an optional feature equivalent to the CPU
-is set, then this means that a stage 2 Permission fault must
+FEAT_BBM, which permits an OS to switch a range of memory between
-be generated if a stage 1 translation table access is made
+"covered by a huge page" and "covered by a sequence of normal pages"
-to an address that is mapped as Device memory in stage 2.
+without having to engage in the traditional 'break-before-make'
-Implement this.
+dance. (This is particularly important for the SMMU, because devices
 performing I/O through an SMMU are less likely to be able to cope with
 the window in the sequence where an access results in a translation
 fault.)  The SMMU spec explicitly notes that one of the valid ways to
 be a BBM level 2 compliant implementation is:
  * if there are multiple entries in the TLB for an address,
    choose one of them and use it, ignoring the others
 Our SMMU TLB implementation (unlike our CPU TLB) does allow multiple
 TLB entries for an address, because the translation table level is
 part of the SMMUIOTLBKey, and so our IOTLB hashtable can include
 entries for the same address where the leaf was at different levels
 (i.e. both hugepage and normal page). Our TLB lookup implementation in
 smmu_iotlb_lookup() will always find the entry with the lowest level
 (i.e. it prefers the hugepage over the normal page) and ignore any
 others. TLB invalidation correctly removes all TLB entries matching
 the specified address or address range (unless the guest specifies the
 leaf level explicitly, in which case it gets what it asked for). So we
 can validly advertise support for BBML level 2.
 Note that we still can't yet advertise ourselves as an SMMU v3.2,
 because v3.2 requires support for the S2FWB feature, which we don't
 yet implement.
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181012144235.19646-8-peter.maydell@linaro.org
+Reviewed-by: Eric Auger <eric.auger@redhat.com>
 Message-id: 20220426160422.2353158-4-peter.maydell@linaro.org
 ---
- target/arm/helper.c | 21 ++++++++++++++++++++-
+ hw/arm/smmuv3-internal.h | 1 +
-file changed, 20 insertions(+), 1 deletion(-)
+ hw/arm/smmuv3.c          | 1 +
 files changed, 2 insertions(+)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+diff --git a/hw/arm/smmuv3-internal.h b/hw/arm/smmuv3-internal.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/hw/arm/smmuv3-internal.h
-+++ b/target/arm/helper.c
++++ b/hw/arm/smmuv3-internal.h
-@@ -XXX,XX +XXX,XX @@ static hwaddr S1_ptw_translate(CPUARMState *env, ARMMMUIdx mmu_idx,
+@@ -XXX,XX +XXX,XX @@ REG32(IDR2,                0x8)
-         hwaddr s2pa;
+ REG32(IDR3,                0xc)
-         int s2prot;
+      FIELD(IDR3, HAD,         2, 1);
-         int ret;
+      FIELD(IDR3, RIL,        10, 1);
-+        ARMCacheAttrs cacheattrs = {};
++     FIELD(IDR3, BBML,       11, 2);
-+        ARMCacheAttrs *pcacheattrs = NULL;
+ REG32(IDR4,                0x10)
-+
+ REG32(IDR5,                0x14)
-+        if (env->cp15.hcr_el2 & HCR_PTW) {
+      FIELD(IDR5, OAS,         0, 3);
-+            /*
+diff --git a/hw/arm/smmuv3.c b/hw/arm/smmuv3.c
-+             * PTW means we must fault if this S1 walk touches S2 Device
+index XXXXXXX..XXXXXXX 100644
-+             * memory; otherwise we don't care about the attributes and can
+--- a/hw/arm/smmuv3.c
-+             * save the S2 translation the effort of computing them.
++++ b/hw/arm/smmuv3.c
-+             */
+@@ -XXX,XX +XXX,XX @@ static void smmuv3_init_regs(SMMUv3State *s)
-+            pcacheattrs = &cacheattrs;
-+        }
+     s->idr[3] = FIELD_DP32(s->idr[3], IDR3, RIL, 1);
+     s->idr[3] = FIELD_DP32(s->idr[3], IDR3, HAD, 1);
-         ret = get_phys_addr_lpae(env, addr, 0, ARMMMUIdx_S2NS, &s2pa,
++    s->idr[3] = FIELD_DP32(s->idr[3], IDR3, BBML, 2);
--                                 &txattrs, &s2prot, &s2size, fi, NULL);
-+                                 &txattrs, &s2prot, &s2size, fi, pcacheattrs);
+     /* 4K, 16K and 64K granule support */
-         if (ret) {
+     s->idr[5] = FIELD_DP32(s->idr[5], IDR5, GRAN4K, 1);
              assert(fi->type != ARMFault_None);
              fi->s2addr = addr;
@@ -XXX,XX +XXX,XX @@ static hwaddr S1_ptw_translate(CPUARMState *env, ARMMMUIdx mmu_idx,
              fi->s1ptw = true;
              return ~0;
          }
 +        if (pcacheattrs && (pcacheattrs->attrs & 0xf0) == 0) {
 +            /* Access was to Device memory: generate Permission fault */
 +            fi->type = ARMFault_Permission;
 +            fi->s2addr = addr;
 +            fi->stage2 = true;
 +            fi->s1ptw = true;
 +            return ~0;
 +        }
          addr = s2pa;
      }
      return addr;
 --
-.19.1
+.25.1

As promised, another pullreq... This one's mostly RTH's patches.

thanks
-- PMM

The following changes since commit 784c2e4f232adf5ef47a84a262ec72a07d068d6a:

Merge remote-tracking branch 'remotes/jasowang/tags/net-pull-request' into staging (2018-10-19 15:30:40 +0100)

are available in the Git repository at:

https://git.linaro.org/people/pmaydell/qemu-arm.git tags/pull-target-arm-20181019

for you to fetch changes up to 88c9add25e7120e8622796c81ad3f3fb7f8d40e7:

target/arm: Only flush tlb if ASID changes (2018-10-19 17:38:48 +0100)

----------------------------------------------------------------
target-arm queue:
 * ssi-sd: Make devices picking up backends unavailable with -device
 * Add support for VCPU event states
 * Move towards making ID registers the source of truth for
   whether a guest CPU implements a feature, rather than having
   parallel ID registers and feature bit flags
 * Implement various HCR hypervisor trap/config bits
 * Get IL bit correct for v7 syndrome values
 * Report correct syndrome for FP/SIMD traps to Hyp mode
 * hw/arm/boot: Increase compliance with kernel arm64 boot protocol
 * Refactor A32 Neon to use generic vector infrastructure
 * Fix a bug in A32 VLD2 "(multiple 2-element structures)" insn
 * net: cadence_gem: Report features correctly in ID register
 * Avoid some unnecessary TLB flushes on TTBR register writes

----------------------------------------------------------------
Dongjiu Geng (1):
      target/arm: Add support for VCPU event states

Edgar E. Iglesias (2):
      net: cadence_gem: Announce availability of priority queues
      net: cadence_gem: Announce 64bit addressing support

Markus Armbruster (1):
      ssi-sd: Make devices picking up backends unavailable with -device

Peter Maydell (10):
      target/arm: Improve debug logging of AArch32 exception return
      target/arm: Make switch_mode() file-local
      target/arm: Implement HCR.FB
      target/arm: Implement HCR.DC
      target/arm: ISR_EL1 bits track virtual interrupts if IMO/FMO set
      target/arm: Implement HCR.VI and VF
      target/arm: Implement HCR.PTW
      target/arm: New utility function to extract EC from syndrome
      target/arm: Get IL bit correct for v7 syndrome values
      target/arm: Report correct syndrome for FP/SIMD traps to Hyp mode

Richard Henderson (30):
      target/arm: Move some system registers into a substructure
      target/arm: V8M should not imply V7VE
      target/arm: Convert v8 extensions from feature bits to isar tests
      target/arm: Convert division from feature bits to isar0 tests
      target/arm: Convert jazelle from feature bit to isar1 test
      target/arm: Convert t32ee from feature bit to isar3 test
      target/arm: Convert sve from feature bit to aa64pfr0 test
      target/arm: Convert v8.2-fp16 from feature bit to aa64pfr0 test
      target/arm: Hoist address increment for vector memory ops
      target/arm: Don't call tcg_clear_temp_count
      target/arm: Use tcg_gen_gvec_dup_i64 for LD[1-4]R
      target/arm: Promote consecutive memory ops for aa64
      target/arm: Mark some arrays const
      target/arm: Use gvec for NEON VDUP
      target/arm: Use gvec for NEON VMOV, VMVN, VBIC & VORR (immediate)
      target/arm: Use gvec for NEON_3R_LOGIC insns
      target/arm: Use gvec for NEON_3R_VADD_VSUB insns
      target/arm: Use gvec for NEON_2RM_VMN, NEON_2RM_VNEG
      target/arm: Use gvec for NEON_3R_VMUL
      target/arm: Use gvec for VSHR, VSHL
      target/arm: Use gvec for VSRA
      target/arm: Use gvec for VSRI, VSLI
      target/arm: Use gvec for NEON_3R_VML
      target/arm: Use gvec for NEON_3R_VTST_VCEQ, NEON_3R_VCGT, NEON_3R_VCGE
      target/arm: Use gvec for NEON VLD all lanes
      target/arm: Reorg NEON VLD/VST all elements
      target/arm: Promote consecutive memory ops for aa32
      target/arm: Reorg NEON VLD/VST single element to one lane
      target/arm: Remove writefn from TTBR0_EL3
      target/arm: Only flush tlb if ASID changes

Stewart Hildebrand (1):
      hw/arm/boot: Increase compliance with kernel arm64 boot protocol

From: Markus Armbruster <armbru@redhat.com>

Device models aren't supposed to go on fishing expeditions for
backends.  They should expose suitable properties for the user to set.
For onboard devices, board code sets them.

Device ssi-sd picks up its block backend in its init() method with
drive_get_next() instead.  This mistake is already marked FIXME since
commit af9e40a.

Unset user_creatable to remove the mistake from our external
interface.  Since the SSI bus doesn't support hotplug, only -device
can be affected.  Only certain ARM machines have ssi-sd and provide an
SSI bus for it; this patch breaks -device ssi-sd for these machines.
No actual use of -device ssi-sd is known.

Signed-off-by: Markus Armbruster <armbru@redhat.com>
Acked-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Acked-by: Thomas Huth <thuth@redhat.com>
Message-id: 20181009060835.4608-1-armbru@redhat.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/sd/ssi-sd.c | 2 ++
 1 file changed, 2 insertions(+)

diff --git a/hw/sd/ssi-sd.c b/hw/sd/ssi-sd.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/sd/ssi-sd.c
+++ b/hw/sd/ssi-sd.c
@@ -XXX,XX +XXX,XX @@ static void ssi_sd_class_init(ObjectClass *klass, void *data)
     k->cs_polarity = SSI_CS_LOW;
     dc->vmsd = &vmstate_ssi_sd;
     dc->reset = ssi_sd_reset;
+    /* Reason: init() method uses drive_get_next() */
+    dc->user_creatable = false;
 }
 
 static const TypeInfo ssi_sd_info = {
-- 
2.19.1

From: Dongjiu Geng <gengdongjiu@huawei.com>

This patch extends the qemu-kvm state sync logic with support for
KVM_GET/SET_VCPU_EVENTS, giving access to yet missing SError exception.
And also it can support the exception state migration.

The SError exception states include SError pending state and ESR value,
the kvm_put/get_vcpu_events() will be called when set or get system
registers. When do migration, if source machine has SError pending,
QEMU will do this migration regardless whether the target machine supports
to specify guest ESR value, because if target machine does not support that,
it can also inject the SError with zero ESR value.

Signed-off-by: Dongjiu Geng <gengdongjiu@huawei.com>
Reviewed-by: Andrew Jones <drjones@redhat.com>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 1538067351-23931-3-git-send-email-gengdongjiu@huawei.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h     |  7 ++++++
 target/arm/kvm_arm.h | 24 ++++++++++++++++++
 target/arm/kvm.c     | 60 ++++++++++++++++++++++++++++++++++++++++++++
 target/arm/kvm32.c   | 13 ++++++++++
 target/arm/kvm64.c   | 13 ++++++++++
 target/arm/machine.c | 22 ++++++++++++++++
 6 files changed, 139 insertions(+)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ typedef struct CPUARMState {
          */
     } exception;
 
+    /* Information associated with an SError */
+    struct {
+        uint8_t pending;
+        uint8_t has_esr;
+        uint64_t esr;
+    } serror;
+
     /* Thumb-2 EE state.  */
     uint32_t teecr;
     uint32_t teehbr;
diff --git a/target/arm/kvm_arm.h b/target/arm/kvm_arm.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/kvm_arm.h
+++ b/target/arm/kvm_arm.h
@@ -XXX,XX +XXX,XX @@ bool write_kvmstate_to_list(ARMCPU *cpu);
  */
 void kvm_arm_reset_vcpu(ARMCPU *cpu);
 
+/**
+ * kvm_arm_init_serror_injection:
+ * @cs: CPUState
+ *
+ * Check whether KVM can set guest SError syndrome.
+ */
+void kvm_arm_init_serror_injection(CPUState *cs);
+
+/**
+ * kvm_get_vcpu_events:
+ * @cpu: ARMCPU
+ *
+ * Get VCPU related state from kvm.
+ */
+int kvm_get_vcpu_events(ARMCPU *cpu);
+
+/**
+ * kvm_put_vcpu_events:
+ * @cpu: ARMCPU
+ *
+ * Put VCPU related state to kvm.
+ */
+int kvm_put_vcpu_events(ARMCPU *cpu);
+
 #ifdef CONFIG_KVM
 /**
  * kvm_arm_create_scratch_host_vcpu:
diff --git a/target/arm/kvm.c b/target/arm/kvm.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/kvm.c
+++ b/target/arm/kvm.c
@@ -XXX,XX +XXX,XX @@ const KVMCapabilityInfo kvm_arch_required_capabilities[] = {
 };
 
 static bool cap_has_mp_state;
+static bool cap_has_inject_serror_esr;
 
 static ARMHostCPUFeatures arm_host_cpu_features;
 
@@ -XXX,XX +XXX,XX @@ int kvm_arm_vcpu_init(CPUState *cs)
     return kvm_vcpu_ioctl(cs, KVM_ARM_VCPU_INIT, &init);
 }
 
+void kvm_arm_init_serror_injection(CPUState *cs)
+{
+    cap_has_inject_serror_esr = kvm_check_extension(cs->kvm_state,
+                                    KVM_CAP_ARM_INJECT_SERROR_ESR);
+}
+
 bool kvm_arm_create_scratch_host_vcpu(const uint32_t *cpus_to_try,
                                       int *fdarray,
                                       struct kvm_vcpu_init *init)
@@ -XXX,XX +XXX,XX @@ int kvm_arm_sync_mpstate_to_qemu(ARMCPU *cpu)
     return 0;
 }
 
+int kvm_put_vcpu_events(ARMCPU *cpu)
+{
+    CPUARMState *env = &cpu->env;
+    struct kvm_vcpu_events events;
+    int ret;
+
+    if (!kvm_has_vcpu_events()) {
+        return 0;
+    }
+
+    memset(&events, 0, sizeof(events));
+    events.exception.serror_pending = env->serror.pending;
+
+    /* Inject SError to guest with specified syndrome if host kernel
+     * supports it, otherwise inject SError without syndrome.
+     */
+    if (cap_has_inject_serror_esr) {
+        events.exception.serror_has_esr = env->serror.has_esr;
+        events.exception.serror_esr = env->serror.esr;
+    }
+
+    ret = kvm_vcpu_ioctl(CPU(cpu), KVM_SET_VCPU_EVENTS, &events);
+    if (ret) {
+        error_report("failed to put vcpu events");
+    }
+
+    return ret;
+}
+
+int kvm_get_vcpu_events(ARMCPU *cpu)
+{
+    CPUARMState *env = &cpu->env;
+    struct kvm_vcpu_events events;
+    int ret;
+
+    if (!kvm_has_vcpu_events()) {
+        return 0;
+    }
+
+    memset(&events, 0, sizeof(events));
+    ret = kvm_vcpu_ioctl(CPU(cpu), KVM_GET_VCPU_EVENTS, &events);
+    if (ret) {
+        error_report("failed to get vcpu events");
+        return ret;
+    }
+
+    env->serror.pending = events.exception.serror_pending;
+    env->serror.has_esr = events.exception.serror_has_esr;
+    env->serror.esr = events.exception.serror_esr;
+
+    return 0;
+}
+
 void kvm_arch_pre_run(CPUState *cs, struct kvm_run *run)
 {
 }
diff --git a/target/arm/kvm32.c b/target/arm/kvm32.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/kvm32.c
+++ b/target/arm/kvm32.c
@@ -XXX,XX +XXX,XX @@ int kvm_arch_init_vcpu(CPUState *cs)
     }
     cpu->mp_affinity = mpidr & ARM32_AFFINITY_MASK;
 
+    /* Check whether userspace can specify guest syndrome value */
+    kvm_arm_init_serror_injection(cs);
+
     return kvm_arm_init_cpreg_list(cpu);
 }
 
@@ -XXX,XX +XXX,XX @@ int kvm_arch_put_registers(CPUState *cs, int level)
         return ret;
     }
 
+    ret = kvm_put_vcpu_events(cpu);
+    if (ret) {
+        return ret;
+    }
+
     /* Note that we do not call write_cpustate_to_list()
      * here, so we are only writing the tuple list back to
      * KVM. This is safe because nothing can change the
@@ -XXX,XX +XXX,XX @@ int kvm_arch_get_registers(CPUState *cs)
     }
     vfp_set_fpscr(env, fpscr);
 
+    ret = kvm_get_vcpu_events(cpu);
+    if (ret) {
+        return ret;
+    }
+
     if (!write_kvmstate_to_list(cpu)) {
         return EINVAL;
     }
diff --git a/target/arm/kvm64.c b/target/arm/kvm64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/kvm64.c
+++ b/target/arm/kvm64.c
@@ -XXX,XX +XXX,XX @@ int kvm_arch_init_vcpu(CPUState *cs)
 
     kvm_arm_init_debug(cs);
 
+    /* Check whether user space can specify guest syndrome value */
+    kvm_arm_init_serror_injection(cs);
+
     return kvm_arm_init_cpreg_list(cpu);
 }
 
@@ -XXX,XX +XXX,XX @@ int kvm_arch_put_registers(CPUState *cs, int level)
         return ret;
     }
 
+    ret = kvm_put_vcpu_events(cpu);
+    if (ret) {
+        return ret;
+    }
+
     if (!write_list_to_kvmstate(cpu, level)) {
         return EINVAL;
     }
@@ -XXX,XX +XXX,XX @@ int kvm_arch_get_registers(CPUState *cs)
     }
     vfp_set_fpcr(env, fpr);
 
+    ret = kvm_get_vcpu_events(cpu);
+    if (ret) {
+        return ret;
+    }
+
     if (!write_kvmstate_to_list(cpu)) {
         return EINVAL;
     }
diff --git a/target/arm/machine.c b/target/arm/machine.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/machine.c
+++ b/target/arm/machine.c
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_sve = {
 };
 #endif /* AARCH64 */
 
+static bool serror_needed(void *opaque)
+{
+    ARMCPU *cpu = opaque;
+    CPUARMState *env = &cpu->env;
+
+    return env->serror.pending != 0;
+}
+
+static const VMStateDescription vmstate_serror = {
+    .name = "cpu/serror",
+    .version_id = 1,
+    .minimum_version_id = 1,
+    .needed = serror_needed,
+    .fields = (VMStateField[]) {
+        VMSTATE_UINT8(env.serror.pending, ARMCPU),
+        VMSTATE_UINT8(env.serror.has_esr, ARMCPU),
+        VMSTATE_UINT64(env.serror.esr, ARMCPU),
+        VMSTATE_END_OF_LIST()
+    }
+};
+
 static bool m_needed(void *opaque)
 {
     ARMCPU *cpu = opaque;
@@ -XXX,XX +XXX,XX @@ const VMStateDescription vmstate_arm_cpu = {
 #ifdef TARGET_AARCH64
         &vmstate_sve,
 #endif
+        &vmstate_serror,
         NULL
     }
 };
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Create struct ARMISARegisters, to be accessed during translation.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181016223115.24100-2-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h      |  32 ++++----
 hw/intc/armv7m_nvic.c |  12 +--
 target/arm/cpu.c      | 178 +++++++++++++++++++++---------------------
 target/arm/cpu64.c    |  70 ++++++++---------
 target/arm/helper.c   |  28 +++----
 5 files changed, 162 insertions(+), 158 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ struct ARMCPU {
      * ARMv7AR ARM Architecture Reference Manual. A reset_ prefix
      * is used for reset values of non-constant registers; no reset_
      * prefix means a constant register.
+     * Some of these registers are split out into a substructure that
+     * is shared with the translators to control the ISA.
      */
+    struct ARMISARegisters {
+        uint32_t id_isar0;
+        uint32_t id_isar1;
+        uint32_t id_isar2;
+        uint32_t id_isar3;
+        uint32_t id_isar4;
+        uint32_t id_isar5;
+        uint32_t id_isar6;
+        uint32_t mvfr0;
+        uint32_t mvfr1;
+        uint32_t mvfr2;
+        uint64_t id_aa64isar0;
+        uint64_t id_aa64isar1;
+        uint64_t id_aa64pfr0;
+        uint64_t id_aa64pfr1;
+    } isar;
     uint32_t midr;
     uint32_t revidr;
     uint32_t reset_fpsid;
-    uint32_t mvfr0;
-    uint32_t mvfr1;
-    uint32_t mvfr2;
     uint32_t ctr;
     uint32_t reset_sctlr;
     uint32_t id_pfr0;
@@ -XXX,XX +XXX,XX @@ struct ARMCPU {
     uint32_t id_mmfr2;
     uint32_t id_mmfr3;
     uint32_t id_mmfr4;
-    uint32_t id_isar0;
-    uint32_t id_isar1;
-    uint32_t id_isar2;
-    uint32_t id_isar3;
-    uint32_t id_isar4;
-    uint32_t id_isar5;
-    uint32_t id_isar6;
-    uint64_t id_aa64pfr0;
-    uint64_t id_aa64pfr1;
     uint64_t id_aa64dfr0;
     uint64_t id_aa64dfr1;
     uint64_t id_aa64afr0;
     uint64_t id_aa64afr1;
-    uint64_t id_aa64isar0;
-    uint64_t id_aa64isar1;
     uint64_t id_aa64mmfr0;
     uint64_t id_aa64mmfr1;
     uint32_t dbgdidr;
diff --git a/hw/intc/armv7m_nvic.c b/hw/intc/armv7m_nvic.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/intc/armv7m_nvic.c
+++ b/hw/intc/armv7m_nvic.c
@@ -XXX,XX +XXX,XX @@ static uint32_t nvic_readl(NVICState *s, uint32_t offset, MemTxAttrs attrs)
     case 0xd5c: /* MMFR3.  */
         return cpu->id_mmfr3;
     case 0xd60: /* ISAR0.  */
-        return cpu->id_isar0;
+        return cpu->isar.id_isar0;
     case 0xd64: /* ISAR1.  */
-        return cpu->id_isar1;
+        return cpu->isar.id_isar1;
     case 0xd68: /* ISAR2.  */
-        return cpu->id_isar2;
+        return cpu->isar.id_isar2;
     case 0xd6c: /* ISAR3.  */
-        return cpu->id_isar3;
+        return cpu->isar.id_isar3;
     case 0xd70: /* ISAR4.  */
-        return cpu->id_isar4;
+        return cpu->isar.id_isar4;
     case 0xd74: /* ISAR5.  */
-        return cpu->id_isar5;
+        return cpu->isar.id_isar5;
     case 0xd78: /* CLIDR */
         return cpu->clidr;
     case 0xd7c: /* CTR */
diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_reset(CPUState *s)
     g_hash_table_foreach(cpu->cp_regs, cp_reg_check_reset, cpu);
 
     env->vfp.xregs[ARM_VFP_FPSID] = cpu->reset_fpsid;
-    env->vfp.xregs[ARM_VFP_MVFR0] = cpu->mvfr0;
-    env->vfp.xregs[ARM_VFP_MVFR1] = cpu->mvfr1;
-    env->vfp.xregs[ARM_VFP_MVFR2] = cpu->mvfr2;
+    env->vfp.xregs[ARM_VFP_MVFR0] = cpu->isar.mvfr0;
+    env->vfp.xregs[ARM_VFP_MVFR1] = cpu->isar.mvfr1;
+    env->vfp.xregs[ARM_VFP_MVFR2] = cpu->isar.mvfr2;
 
     cpu->power_state = cpu->start_powered_off ? PSCI_OFF : PSCI_ON;
     s->halted = cpu->start_powered_off;
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
          * registers as well. These are id_pfr1[7:4] and id_aa64pfr0[15:12].
          */
         cpu->id_pfr1 &= ~0xf0;
-        cpu->id_aa64pfr0 &= ~0xf000;
+        cpu->isar.id_aa64pfr0 &= ~0xf000;
     }
 
     if (!cpu->has_el2) {
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
          * registers if we don't have EL2. These are id_pfr1[15:12] and
          * id_aa64pfr0_el1[11:8].
          */
-        cpu->id_aa64pfr0 &= ~0xf00;
+        cpu->isar.id_aa64pfr0 &= ~0xf00;
         cpu->id_pfr1 &= ~0xf000;
     }
 
@@ -XXX,XX +XXX,XX @@ static void arm1136_r2_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_CACHE_BLOCK_OPS);
     cpu->midr = 0x4107b362;
     cpu->reset_fpsid = 0x410120b4;
-    cpu->mvfr0 = 0x11111111;
-    cpu->mvfr1 = 0x00000000;
+    cpu->isar.mvfr0 = 0x11111111;
+    cpu->isar.mvfr1 = 0x00000000;
     cpu->ctr = 0x1dd20d2;
     cpu->reset_sctlr = 0x00050078;
     cpu->id_pfr0 = 0x111;
@@ -XXX,XX +XXX,XX @@ static void arm1136_r2_initfn(Object *obj)
     cpu->id_mmfr0 = 0x01130003;
     cpu->id_mmfr1 = 0x10030302;
     cpu->id_mmfr2 = 0x01222110;
-    cpu->id_isar0 = 0x00140011;
-    cpu->id_isar1 = 0x12002111;
-    cpu->id_isar2 = 0x11231111;
-    cpu->id_isar3 = 0x01102131;
-    cpu->id_isar4 = 0x141;
+    cpu->isar.id_isar0 = 0x00140011;
+    cpu->isar.id_isar1 = 0x12002111;
+    cpu->isar.id_isar2 = 0x11231111;
+    cpu->isar.id_isar3 = 0x01102131;
+    cpu->isar.id_isar4 = 0x141;
     cpu->reset_auxcr = 7;
 }
 
@@ -XXX,XX +XXX,XX @@ static void arm1136_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_CACHE_BLOCK_OPS);
     cpu->midr = 0x4117b363;
     cpu->reset_fpsid = 0x410120b4;
-    cpu->mvfr0 = 0x11111111;
-    cpu->mvfr1 = 0x00000000;
+    cpu->isar.mvfr0 = 0x11111111;
+    cpu->isar.mvfr1 = 0x00000000;
     cpu->ctr = 0x1dd20d2;
     cpu->reset_sctlr = 0x00050078;
     cpu->id_pfr0 = 0x111;
@@ -XXX,XX +XXX,XX @@ static void arm1136_initfn(Object *obj)
     cpu->id_mmfr0 = 0x01130003;
     cpu->id_mmfr1 = 0x10030302;
     cpu->id_mmfr2 = 0x01222110;
-    cpu->id_isar0 = 0x00140011;
-    cpu->id_isar1 = 0x12002111;
-    cpu->id_isar2 = 0x11231111;
-    cpu->id_isar3 = 0x01102131;
-    cpu->id_isar4 = 0x141;
+    cpu->isar.id_isar0 = 0x00140011;
+    cpu->isar.id_isar1 = 0x12002111;
+    cpu->isar.id_isar2 = 0x11231111;
+    cpu->isar.id_isar3 = 0x01102131;
+    cpu->isar.id_isar4 = 0x141;
     cpu->reset_auxcr = 7;
 }
 
@@ -XXX,XX +XXX,XX @@ static void arm1176_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_EL3);
     cpu->midr = 0x410fb767;
     cpu->reset_fpsid = 0x410120b5;
-    cpu->mvfr0 = 0x11111111;
-    cpu->mvfr1 = 0x00000000;
+    cpu->isar.mvfr0 = 0x11111111;
+    cpu->isar.mvfr1 = 0x00000000;
     cpu->ctr = 0x1dd20d2;
     cpu->reset_sctlr = 0x00050078;
     cpu->id_pfr0 = 0x111;
@@ -XXX,XX +XXX,XX @@ static void arm1176_initfn(Object *obj)
     cpu->id_mmfr0 = 0x01130003;
     cpu->id_mmfr1 = 0x10030302;
     cpu->id_mmfr2 = 0x01222100;
-    cpu->id_isar0 = 0x0140011;
-    cpu->id_isar1 = 0x12002111;
-    cpu->id_isar2 = 0x11231121;
-    cpu->id_isar3 = 0x01102131;
-    cpu->id_isar4 = 0x01141;
+    cpu->isar.id_isar0 = 0x0140011;
+    cpu->isar.id_isar1 = 0x12002111;
+    cpu->isar.id_isar2 = 0x11231121;
+    cpu->isar.id_isar3 = 0x01102131;
+    cpu->isar.id_isar4 = 0x01141;
     cpu->reset_auxcr = 7;
 }
 
@@ -XXX,XX +XXX,XX @@ static void arm11mpcore_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
     cpu->midr = 0x410fb022;
     cpu->reset_fpsid = 0x410120b4;
-    cpu->mvfr0 = 0x11111111;
-    cpu->mvfr1 = 0x00000000;
+    cpu->isar.mvfr0 = 0x11111111;
+    cpu->isar.mvfr1 = 0x00000000;
     cpu->ctr = 0x1d192992; /* 32K icache 32K dcache */
     cpu->id_pfr0 = 0x111;
     cpu->id_pfr1 = 0x1;
@@ -XXX,XX +XXX,XX @@ static void arm11mpcore_initfn(Object *obj)
     cpu->id_mmfr0 = 0x01100103;
     cpu->id_mmfr1 = 0x10020302;
     cpu->id_mmfr2 = 0x01222000;
-    cpu->id_isar0 = 0x00100011;
-    cpu->id_isar1 = 0x12002111;
-    cpu->id_isar2 = 0x11221011;
-    cpu->id_isar3 = 0x01102131;
-    cpu->id_isar4 = 0x141;
+    cpu->isar.id_isar0 = 0x00100011;
+    cpu->isar.id_isar1 = 0x12002111;
+    cpu->isar.id_isar2 = 0x11221011;
+    cpu->isar.id_isar3 = 0x01102131;
+    cpu->isar.id_isar4 = 0x141;
     cpu->reset_auxcr = 1;
 }
 
@@ -XXX,XX +XXX,XX @@ static void cortex_m3_initfn(Object *obj)
     cpu->id_mmfr1 = 0x00000000;
     cpu->id_mmfr2 = 0x00000000;
     cpu->id_mmfr3 = 0x00000000;
-    cpu->id_isar0 = 0x01141110;
-    cpu->id_isar1 = 0x02111000;
-    cpu->id_isar2 = 0x21112231;
-    cpu->id_isar3 = 0x01111110;
-    cpu->id_isar4 = 0x01310102;
-    cpu->id_isar5 = 0x00000000;
-    cpu->id_isar6 = 0x00000000;
+    cpu->isar.id_isar0 = 0x01141110;
+    cpu->isar.id_isar1 = 0x02111000;
+    cpu->isar.id_isar2 = 0x21112231;
+    cpu->isar.id_isar3 = 0x01111110;
+    cpu->isar.id_isar4 = 0x01310102;
+    cpu->isar.id_isar5 = 0x00000000;
+    cpu->isar.id_isar6 = 0x00000000;
 }
 
 static void cortex_m4_initfn(Object *obj)
@@ -XXX,XX +XXX,XX @@ static void cortex_m4_initfn(Object *obj)
     cpu->id_mmfr1 = 0x00000000;
     cpu->id_mmfr2 = 0x00000000;
     cpu->id_mmfr3 = 0x00000000;
-    cpu->id_isar0 = 0x01141110;
-    cpu->id_isar1 = 0x02111000;
-    cpu->id_isar2 = 0x21112231;
-    cpu->id_isar3 = 0x01111110;
-    cpu->id_isar4 = 0x01310102;
-    cpu->id_isar5 = 0x00000000;
-    cpu->id_isar6 = 0x00000000;
+    cpu->isar.id_isar0 = 0x01141110;
+    cpu->isar.id_isar1 = 0x02111000;
+    cpu->isar.id_isar2 = 0x21112231;
+    cpu->isar.id_isar3 = 0x01111110;
+    cpu->isar.id_isar4 = 0x01310102;
+    cpu->isar.id_isar5 = 0x00000000;
+    cpu->isar.id_isar6 = 0x00000000;
 }
 
 static void cortex_m33_initfn(Object *obj)
@@ -XXX,XX +XXX,XX @@ static void cortex_m33_initfn(Object *obj)
     cpu->id_mmfr1 = 0x00000000;
     cpu->id_mmfr2 = 0x01000000;
     cpu->id_mmfr3 = 0x00000000;
-    cpu->id_isar0 = 0x01101110;
-    cpu->id_isar1 = 0x02212000;
-    cpu->id_isar2 = 0x20232232;
-    cpu->id_isar3 = 0x01111131;
-    cpu->id_isar4 = 0x01310132;
-    cpu->id_isar5 = 0x00000000;
-    cpu->id_isar6 = 0x00000000;
+    cpu->isar.id_isar0 = 0x01101110;
+    cpu->isar.id_isar1 = 0x02212000;
+    cpu->isar.id_isar2 = 0x20232232;
+    cpu->isar.id_isar3 = 0x01111131;
+    cpu->isar.id_isar4 = 0x01310132;
+    cpu->isar.id_isar5 = 0x00000000;
+    cpu->isar.id_isar6 = 0x00000000;
     cpu->clidr = 0x00000000;
     cpu->ctr = 0x8000c000;
 }
@@ -XXX,XX +XXX,XX @@ static void cortex_r5_initfn(Object *obj)
     cpu->id_mmfr1 = 0x00000000;
     cpu->id_mmfr2 = 0x01200000;
     cpu->id_mmfr3 = 0x0211;
-    cpu->id_isar0 = 0x02101111;
-    cpu->id_isar1 = 0x13112111;
-    cpu->id_isar2 = 0x21232141;
-    cpu->id_isar3 = 0x01112131;
-    cpu->id_isar4 = 0x0010142;
-    cpu->id_isar5 = 0x0;
-    cpu->id_isar6 = 0x0;
+    cpu->isar.id_isar0 = 0x02101111;
+    cpu->isar.id_isar1 = 0x13112111;
+    cpu->isar.id_isar2 = 0x21232141;
+    cpu->isar.id_isar3 = 0x01112131;
+    cpu->isar.id_isar4 = 0x0010142;
+    cpu->isar.id_isar5 = 0x0;
+    cpu->isar.id_isar6 = 0x0;
     cpu->mp_is_up = true;
     cpu->pmsav7_dregion = 16;
     define_arm_cp_regs(cpu, cortexr5_cp_reginfo);
@@ -XXX,XX +XXX,XX @@ static void cortex_a8_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_EL3);
     cpu->midr = 0x410fc080;
     cpu->reset_fpsid = 0x410330c0;
-    cpu->mvfr0 = 0x11110222;
-    cpu->mvfr1 = 0x00011111;
+    cpu->isar.mvfr0 = 0x11110222;
+    cpu->isar.mvfr1 = 0x00011111;
     cpu->ctr = 0x82048004;
     cpu->reset_sctlr = 0x00c50078;
     cpu->id_pfr0 = 0x1031;
@@ -XXX,XX +XXX,XX @@ static void cortex_a8_initfn(Object *obj)
     cpu->id_mmfr1 = 0x20000000;
     cpu->id_mmfr2 = 0x01202000;
     cpu->id_mmfr3 = 0x11;
-    cpu->id_isar0 = 0x00101111;
-    cpu->id_isar1 = 0x12112111;
-    cpu->id_isar2 = 0x21232031;
-    cpu->id_isar3 = 0x11112131;
-    cpu->id_isar4 = 0x00111142;
+    cpu->isar.id_isar0 = 0x00101111;
+    cpu->isar.id_isar1 = 0x12112111;
+    cpu->isar.id_isar2 = 0x21232031;
+    cpu->isar.id_isar3 = 0x11112131;
+    cpu->isar.id_isar4 = 0x00111142;
     cpu->dbgdidr = 0x15141000;
     cpu->clidr = (1 << 27) | (2 << 24) | 3;
     cpu->ccsidr[0] = 0xe007e01a; /* 16k L1 dcache. */
@@ -XXX,XX +XXX,XX @@ static void cortex_a9_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_CBAR);
     cpu->midr = 0x410fc090;
     cpu->reset_fpsid = 0x41033090;
-    cpu->mvfr0 = 0x11110222;
-    cpu->mvfr1 = 0x01111111;
+    cpu->isar.mvfr0 = 0x11110222;
+    cpu->isar.mvfr1 = 0x01111111;
     cpu->ctr = 0x80038003;
     cpu->reset_sctlr = 0x00c50078;
     cpu->id_pfr0 = 0x1031;
@@ -XXX,XX +XXX,XX @@ static void cortex_a9_initfn(Object *obj)
     cpu->id_mmfr1 = 0x20000000;
     cpu->id_mmfr2 = 0x01230000;
     cpu->id_mmfr3 = 0x00002111;
-    cpu->id_isar0 = 0x00101111;
-    cpu->id_isar1 = 0x13112111;
-    cpu->id_isar2 = 0x21232041;
-    cpu->id_isar3 = 0x11112131;
-    cpu->id_isar4 = 0x00111142;
+    cpu->isar.id_isar0 = 0x00101111;
+    cpu->isar.id_isar1 = 0x13112111;
+    cpu->isar.id_isar2 = 0x21232041;
+    cpu->isar.id_isar3 = 0x11112131;
+    cpu->isar.id_isar4 = 0x00111142;
     cpu->dbgdidr = 0x35141000;
     cpu->clidr = (1 << 27) | (1 << 24) | 3;
     cpu->ccsidr[0] = 0xe00fe019; /* 16k L1 dcache. */
@@ -XXX,XX +XXX,XX @@ static void cortex_a7_initfn(Object *obj)
     cpu->kvm_target = QEMU_KVM_ARM_TARGET_CORTEX_A7;
     cpu->midr = 0x410fc075;
     cpu->reset_fpsid = 0x41023075;
-    cpu->mvfr0 = 0x10110222;
-    cpu->mvfr1 = 0x11111111;
+    cpu->isar.mvfr0 = 0x10110222;
+    cpu->isar.mvfr1 = 0x11111111;
     cpu->ctr = 0x84448003;
     cpu->reset_sctlr = 0x00c50078;
     cpu->id_pfr0 = 0x00001131;
@@ -XXX,XX +XXX,XX @@ static void cortex_a7_initfn(Object *obj)
     /* a7_mpcore_r0p5_trm, page 4-4 gives 0x01101110; but
      * table 4-41 gives 0x02101110, which includes the arm div insns.
      */
-    cpu->id_isar0 = 0x02101110;
-    cpu->id_isar1 = 0x13112111;
-    cpu->id_isar2 = 0x21232041;
-    cpu->id_isar3 = 0x11112131;
-    cpu->id_isar4 = 0x10011142;
+    cpu->isar.id_isar0 = 0x02101110;
+    cpu->isar.id_isar1 = 0x13112111;
+    cpu->isar.id_isar2 = 0x21232041;
+    cpu->isar.id_isar3 = 0x11112131;
+    cpu->isar.id_isar4 = 0x10011142;
     cpu->dbgdidr = 0x3515f005;
     cpu->clidr = 0x0a200023;
     cpu->ccsidr[0] = 0x701fe00a; /* 32K L1 dcache */
@@ -XXX,XX +XXX,XX @@ static void cortex_a15_initfn(Object *obj)
     cpu->kvm_target = QEMU_KVM_ARM_TARGET_CORTEX_A15;
     cpu->midr = 0x412fc0f1;
     cpu->reset_fpsid = 0x410430f0;
-    cpu->mvfr0 = 0x10110222;
-    cpu->mvfr1 = 0x11111111;
+    cpu->isar.mvfr0 = 0x10110222;
+    cpu->isar.mvfr1 = 0x11111111;
     cpu->ctr = 0x8444c004;
     cpu->reset_sctlr = 0x00c50078;
     cpu->id_pfr0 = 0x00001131;
@@ -XXX,XX +XXX,XX @@ static void cortex_a15_initfn(Object *obj)
     cpu->id_mmfr1 = 0x20000000;
     cpu->id_mmfr2 = 0x01240000;
     cpu->id_mmfr3 = 0x02102211;
-    cpu->id_isar0 = 0x02101110;
-    cpu->id_isar1 = 0x13112111;
-    cpu->id_isar2 = 0x21232041;
-    cpu->id_isar3 = 0x11112131;
-    cpu->id_isar4 = 0x10011142;
+    cpu->isar.id_isar0 = 0x02101110;
+    cpu->isar.id_isar1 = 0x13112111;
+    cpu->isar.id_isar2 = 0x21232041;
+    cpu->isar.id_isar3 = 0x11112131;
+    cpu->isar.id_isar4 = 0x10011142;
     cpu->dbgdidr = 0x3515f021;
     cpu->clidr = 0x0a200023;
     cpu->ccsidr[0] = 0x701fe00a; /* 32K L1 dcache */
diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu64.c
+++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_a57_initfn(Object *obj)
     cpu->midr = 0x411fd070;
     cpu->revidr = 0x00000000;
     cpu->reset_fpsid = 0x41034070;
-    cpu->mvfr0 = 0x10110222;
-    cpu->mvfr1 = 0x12111111;
-    cpu->mvfr2 = 0x00000043;
+    cpu->isar.mvfr0 = 0x10110222;
+    cpu->isar.mvfr1 = 0x12111111;
+    cpu->isar.mvfr2 = 0x00000043;
     cpu->ctr = 0x8444c004;
     cpu->reset_sctlr = 0x00c50838;
     cpu->id_pfr0 = 0x00000131;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a57_initfn(Object *obj)
     cpu->id_mmfr1 = 0x40000000;
     cpu->id_mmfr2 = 0x01260000;
     cpu->id_mmfr3 = 0x02102211;
-    cpu->id_isar0 = 0x02101110;
-    cpu->id_isar1 = 0x13112111;
-    cpu->id_isar2 = 0x21232042;
-    cpu->id_isar3 = 0x01112131;
-    cpu->id_isar4 = 0x00011142;
-    cpu->id_isar5 = 0x00011121;
-    cpu->id_isar6 = 0;
-    cpu->id_aa64pfr0 = 0x00002222;
+    cpu->isar.id_isar0 = 0x02101110;
+    cpu->isar.id_isar1 = 0x13112111;
+    cpu->isar.id_isar2 = 0x21232042;
+    cpu->isar.id_isar3 = 0x01112131;
+    cpu->isar.id_isar4 = 0x00011142;
+    cpu->isar.id_isar5 = 0x00011121;
+    cpu->isar.id_isar6 = 0;
+    cpu->isar.id_aa64pfr0 = 0x00002222;
     cpu->id_aa64dfr0 = 0x10305106;
     cpu->pmceid0 = 0x00000000;
     cpu->pmceid1 = 0x00000000;
-    cpu->id_aa64isar0 = 0x00011120;
+    cpu->isar.id_aa64isar0 = 0x00011120;
     cpu->id_aa64mmfr0 = 0x00001124;
     cpu->dbgdidr = 0x3516d000;
     cpu->clidr = 0x0a200023;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a53_initfn(Object *obj)
     cpu->midr = 0x410fd034;
     cpu->revidr = 0x00000000;
     cpu->reset_fpsid = 0x41034070;
-    cpu->mvfr0 = 0x10110222;
-    cpu->mvfr1 = 0x12111111;
-    cpu->mvfr2 = 0x00000043;
+    cpu->isar.mvfr0 = 0x10110222;
+    cpu->isar.mvfr1 = 0x12111111;
+    cpu->isar.mvfr2 = 0x00000043;
     cpu->ctr = 0x84448004; /* L1Ip = VIPT */
     cpu->reset_sctlr = 0x00c50838;
     cpu->id_pfr0 = 0x00000131;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a53_initfn(Object *obj)
     cpu->id_mmfr1 = 0x40000000;
     cpu->id_mmfr2 = 0x01260000;
     cpu->id_mmfr3 = 0x02102211;
-    cpu->id_isar0 = 0x02101110;
-    cpu->id_isar1 = 0x13112111;
-    cpu->id_isar2 = 0x21232042;
-    cpu->id_isar3 = 0x01112131;
-    cpu->id_isar4 = 0x00011142;
-    cpu->id_isar5 = 0x00011121;
-    cpu->id_isar6 = 0;
-    cpu->id_aa64pfr0 = 0x00002222;
+    cpu->isar.id_isar0 = 0x02101110;
+    cpu->isar.id_isar1 = 0x13112111;
+    cpu->isar.id_isar2 = 0x21232042;
+    cpu->isar.id_isar3 = 0x01112131;
+    cpu->isar.id_isar4 = 0x00011142;
+    cpu->isar.id_isar5 = 0x00011121;
+    cpu->isar.id_isar6 = 0;
+    cpu->isar.id_aa64pfr0 = 0x00002222;
     cpu->id_aa64dfr0 = 0x10305106;
-    cpu->id_aa64isar0 = 0x00011120;
+    cpu->isar.id_aa64isar0 = 0x00011120;
     cpu->id_aa64mmfr0 = 0x00001122; /* 40 bit physical addr */
     cpu->dbgdidr = 0x3516d000;
     cpu->clidr = 0x0a200023;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a72_initfn(Object *obj)
     cpu->midr = 0x410fd083;
     cpu->revidr = 0x00000000;
     cpu->reset_fpsid = 0x41034080;
-    cpu->mvfr0 = 0x10110222;
-    cpu->mvfr1 = 0x12111111;
-    cpu->mvfr2 = 0x00000043;
+    cpu->isar.mvfr0 = 0x10110222;
+    cpu->isar.mvfr1 = 0x12111111;
+    cpu->isar.mvfr2 = 0x00000043;
     cpu->ctr = 0x8444c004;
     cpu->reset_sctlr = 0x00c50838;
     cpu->id_pfr0 = 0x00000131;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a72_initfn(Object *obj)
     cpu->id_mmfr1 = 0x40000000;
     cpu->id_mmfr2 = 0x01260000;
     cpu->id_mmfr3 = 0x02102211;
-    cpu->id_isar0 = 0x02101110;
-    cpu->id_isar1 = 0x13112111;
-    cpu->id_isar2 = 0x21232042;
-    cpu->id_isar3 = 0x01112131;
-    cpu->id_isar4 = 0x00011142;
-    cpu->id_isar5 = 0x00011121;
-    cpu->id_aa64pfr0 = 0x00002222;
+    cpu->isar.id_isar0 = 0x02101110;
+    cpu->isar.id_isar1 = 0x13112111;
+    cpu->isar.id_isar2 = 0x21232042;
+    cpu->isar.id_isar3 = 0x01112131;
+    cpu->isar.id_isar4 = 0x00011142;
+    cpu->isar.id_isar5 = 0x00011121;
+    cpu->isar.id_aa64pfr0 = 0x00002222;
     cpu->id_aa64dfr0 = 0x10305106;
     cpu->pmceid0 = 0x00000000;
     cpu->pmceid1 = 0x00000000;
-    cpu->id_aa64isar0 = 0x00011120;
+    cpu->isar.id_aa64isar0 = 0x00011120;
     cpu->id_aa64mmfr0 = 0x00001124;
     cpu->dbgdidr = 0x3516d000;
     cpu->clidr = 0x0a200023;
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static uint64_t id_pfr1_read(CPUARMState *env, const ARMCPRegInfo *ri)
 static uint64_t id_aa64pfr0_read(CPUARMState *env, const ARMCPRegInfo *ri)
 {
     ARMCPU *cpu = arm_env_get_cpu(env);
-    uint64_t pfr0 = cpu->id_aa64pfr0;
+    uint64_t pfr0 = cpu->isar.id_aa64pfr0;
 
     if (env->gicv3state) {
         pfr0 |= 1 << 24;
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
             { .name = "ID_ISAR0", .state = ARM_CP_STATE_BOTH,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 0,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_isar0 },
+              .resetvalue = cpu->isar.id_isar0 },
             { .name = "ID_ISAR1", .state = ARM_CP_STATE_BOTH,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 1,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_isar1 },
+              .resetvalue = cpu->isar.id_isar1 },
             { .name = "ID_ISAR2", .state = ARM_CP_STATE_BOTH,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 2,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_isar2 },
+              .resetvalue = cpu->isar.id_isar2 },
             { .name = "ID_ISAR3", .state = ARM_CP_STATE_BOTH,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 3,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_isar3 },
+              .resetvalue = cpu->isar.id_isar3 },
             { .name = "ID_ISAR4", .state = ARM_CP_STATE_BOTH,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 4,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_isar4 },
+              .resetvalue = cpu->isar.id_isar4 },
             { .name = "ID_ISAR5", .state = ARM_CP_STATE_BOTH,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 5,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_isar5 },
+              .resetvalue = cpu->isar.id_isar5 },
             { .name = "ID_MMFR4", .state = ARM_CP_STATE_BOTH,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 6,
               .access = PL1_R, .type = ARM_CP_CONST,
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
             { .name = "ID_ISAR6", .state = ARM_CP_STATE_BOTH,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 7,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_isar6 },
+              .resetvalue = cpu->isar.id_isar6 },
             REGINFO_SENTINEL
         };
         define_arm_cp_regs(cpu, v6_idregs);
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
             { .name = "ID_AA64PFR1_EL1", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 4, .opc2 = 1,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_aa64pfr1},
+              .resetvalue = cpu->isar.id_aa64pfr1},
             { .name = "ID_AA64PFR2_EL1_RESERVED", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 4, .opc2 = 2,
               .access = PL1_R, .type = ARM_CP_CONST,
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
             { .name = "ID_AA64ISAR0_EL1", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 6, .opc2 = 0,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_aa64isar0 },
+              .resetvalue = cpu->isar.id_aa64isar0 },
             { .name = "ID_AA64ISAR1_EL1", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 6, .opc2 = 1,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_aa64isar1 },
+              .resetvalue = cpu->isar.id_aa64isar1 },
             { .name = "ID_AA64ISAR2_EL1_RESERVED", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 6, .opc2 = 2,
               .access = PL1_R, .type = ARM_CP_CONST,
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
             { .name = "MVFR0_EL1", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 3, .opc2 = 0,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->mvfr0 },
+              .resetvalue = cpu->isar.mvfr0 },
             { .name = "MVFR1_EL1", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 3, .opc2 = 1,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->mvfr1 },
+              .resetvalue = cpu->isar.mvfr1 },
             { .name = "MVFR2_EL1", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 3, .opc2 = 2,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->mvfr2 },
+              .resetvalue = cpu->isar.mvfr2 },
             { .name = "MVFR3_EL1_RESERVED", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 3, .opc2 = 3,
               .access = PL1_R, .type = ARM_CP_CONST,
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Instantiating mps2-an505 (cortex-m33) will fail make check when
V7VE asserts that ID_ISAR0.Divide includes ARM division.  It is
also wrong to include ARM_FEATURE_LPAE.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181016223115.24100-3-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.c | 6 +++++-
 1 file changed, 5 insertions(+), 1 deletion(-)

diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
 
     /* Some features automatically imply others: */
     if (arm_feature(env, ARM_FEATURE_V8)) {
-        set_feature(env, ARM_FEATURE_V7VE);
+        if (arm_feature(env, ARM_FEATURE_M)) {
+            set_feature(env, ARM_FEATURE_V7);
+        } else {
+            set_feature(env, ARM_FEATURE_V7VE);
+        }
     }
     if (arm_feature(env, ARM_FEATURE_V7VE)) {
         /* v7 Virtualization Extensions. In real hardware this implies
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Most of the v8 extensions are self-contained within the ISAR
registers and are not implied by other feature bits, which
makes them the easiest to convert.

Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181016223115.24100-4-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h           | 131 +++++++++++++++++++++++++++++++++----
 target/arm/translate.h     |   7 ++
 linux-user/elfload.c       |  46 ++++++++-----
 target/arm/cpu.c           |  27 +++++---
 target/arm/cpu64.c         |  57 +++++++++-------
 target/arm/translate-a64.c | 101 ++++++++++++++--------------
 target/arm/translate.c     |  36 +++++-----
 7 files changed, 273 insertions(+), 132 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ typedef enum ARMPSCIState {
     PSCI_ON_PENDING = 2
 } ARMPSCIState;
 
+typedef struct ARMISARegisters ARMISARegisters;
+
 /**
  * ARMCPU:
  * @env: #CPUARMState
@@ -XXX,XX +XXX,XX @@ enum arm_features {
     ARM_FEATURE_LPAE, /* has Large Physical Address Extension */
     ARM_FEATURE_V8,
     ARM_FEATURE_AARCH64, /* supports 64 bit mode */
-    ARM_FEATURE_V8_AES, /* implements AES part of v8 Crypto Extensions */
     ARM_FEATURE_CBAR, /* has cp15 CBAR */
     ARM_FEATURE_CRC, /* ARMv8 CRC instructions */
     ARM_FEATURE_CBAR_RO, /* has cp15 CBAR and it is read-only */
     ARM_FEATURE_EL2, /* has EL2 Virtualization support */
     ARM_FEATURE_EL3, /* has EL3 Secure monitor support */
-    ARM_FEATURE_V8_SHA1, /* implements SHA1 part of v8 Crypto Extensions */
-    ARM_FEATURE_V8_SHA256, /* implements SHA256 part of v8 Crypto Extensions */
-    ARM_FEATURE_V8_PMULL, /* implements PMULL part of v8 Crypto Extensions */
     ARM_FEATURE_THUMB_DSP, /* DSP insns supported in the Thumb encodings */
     ARM_FEATURE_PMU, /* has PMU support */
     ARM_FEATURE_VBAR, /* has cp15 VBAR */
     ARM_FEATURE_M_SECURITY, /* M profile Security Extension */
     ARM_FEATURE_JAZELLE, /* has (trivial) Jazelle implementation */
     ARM_FEATURE_SVE, /* has Scalable Vector Extension */
-    ARM_FEATURE_V8_SHA512, /* implements SHA512 part of v8 Crypto Extensions */
-    ARM_FEATURE_V8_SHA3, /* implements SHA3 part of v8 Crypto Extensions */
-    ARM_FEATURE_V8_SM3, /* implements SM3 part of v8 Crypto Extensions */
-    ARM_FEATURE_V8_SM4, /* implements SM4 part of v8 Crypto Extensions */
-    ARM_FEATURE_V8_ATOMICS, /* ARMv8.1-Atomics feature */
-    ARM_FEATURE_V8_RDM, /* implements v8.1 simd round multiply */
-    ARM_FEATURE_V8_DOTPROD, /* implements v8.2 simd dot product */
     ARM_FEATURE_V8_FP16, /* implements v8.2 half-precision float */
-    ARM_FEATURE_V8_FCMA, /* has complex number part of v8.3 extensions.  */
     ARM_FEATURE_M_MAIN, /* M profile Main Extension */
 };
 
@@ -XXX,XX +XXX,XX @@ static inline uint64_t *aa64_vfp_qreg(CPUARMState *env, unsigned regno)
 /* Shared between translate-sve.c and sve_helper.c.  */
 extern const uint64_t pred_esz_masks[4];
 
+/*
+ * 32-bit feature tests via id registers.
+ */
+static inline bool isar_feature_aa32_aes(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) != 0;
+}
+
+static inline bool isar_feature_aa32_pmull(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) > 1;
+}
+
+static inline bool isar_feature_aa32_sha1(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar5, ID_ISAR5, SHA1) != 0;
+}
+
+static inline bool isar_feature_aa32_sha2(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar5, ID_ISAR5, SHA2) != 0;
+}
+
+static inline bool isar_feature_aa32_crc32(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar5, ID_ISAR5, CRC32) != 0;
+}
+
+static inline bool isar_feature_aa32_rdm(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar5, ID_ISAR5, RDM) != 0;
+}
+
+static inline bool isar_feature_aa32_vcma(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar5, ID_ISAR5, VCMA) != 0;
+}
+
+static inline bool isar_feature_aa32_dp(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar6, ID_ISAR6, DP) != 0;
+}
+
+/*
+ * 64-bit feature tests via id registers.
+ */
+static inline bool isar_feature_aa64_aes(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, AES) != 0;
+}
+
+static inline bool isar_feature_aa64_pmull(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, AES) > 1;
+}
+
+static inline bool isar_feature_aa64_sha1(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SHA1) != 0;
+}
+
+static inline bool isar_feature_aa64_sha256(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SHA2) != 0;
+}
+
+static inline bool isar_feature_aa64_sha512(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SHA2) > 1;
+}
+
+static inline bool isar_feature_aa64_crc32(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, CRC32) != 0;
+}
+
+static inline bool isar_feature_aa64_atomics(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, ATOMIC) != 0;
+}
+
+static inline bool isar_feature_aa64_rdm(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, RDM) != 0;
+}
+
+static inline bool isar_feature_aa64_sha3(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SHA3) != 0;
+}
+
+static inline bool isar_feature_aa64_sm3(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SM3) != 0;
+}
+
+static inline bool isar_feature_aa64_sm4(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SM4) != 0;
+}
+
+static inline bool isar_feature_aa64_dp(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, DP) != 0;
+}
+
+static inline bool isar_feature_aa64_fcma(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar1, ID_AA64ISAR1, FCMA) != 0;
+}
+
+/*
+ * Forward to the above feature tests given an ARMCPU pointer.
+ */
+#define cpu_isar_feature(name, cpu) \
+    ({ ARMCPU *cpu_ = (cpu); isar_feature_##name(&cpu_->isar); })
+
 #endif
diff --git a/target/arm/translate.h b/target/arm/translate.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.h
+++ b/target/arm/translate.h
@@ -XXX,XX +XXX,XX @@
 /* internal defines */
 typedef struct DisasContext {
     DisasContextBase base;
+    const ARMISARegisters *isar;
 
     target_ulong pc;
     target_ulong page_start;
@@ -XXX,XX +XXX,XX @@ static inline TCGv_i32 get_ahp_flag(void)
     return ret;
 }
 
+/*
+ * Forward to the isar_feature_* tests given a DisasContext pointer.
+ */
+#define dc_isar_feature(name, ctx) \
+    ({ DisasContext *ctx_ = (ctx); isar_feature_##name(ctx_->isar); })
+
 #endif /* TARGET_ARM_TRANSLATE_H */
diff --git a/linux-user/elfload.c b/linux-user/elfload.c
index XXXXXXX..XXXXXXX 100644
--- a/linux-user/elfload.c
+++ b/linux-user/elfload.c
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
     /* probe for the extra features */
 #define GET_FEATURE(feat, hwcap) \
     do { if (arm_feature(&cpu->env, feat)) { hwcaps |= hwcap; } } while (0)
+
+#define GET_FEATURE_ID(feat, hwcap) \
+    do { if (cpu_isar_feature(feat, cpu)) { hwcaps |= hwcap; } } while (0)
+
     /* EDSP is in v5TE and above, but all our v5 CPUs are v5TE */
     GET_FEATURE(ARM_FEATURE_V5, ARM_HWCAP_ARM_EDSP);
     GET_FEATURE(ARM_FEATURE_VFP, ARM_HWCAP_ARM_VFP);
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap2(void)
     ARMCPU *cpu = ARM_CPU(thread_cpu);
     uint32_t hwcaps = 0;
 
-    GET_FEATURE(ARM_FEATURE_V8_AES, ARM_HWCAP2_ARM_AES);
-    GET_FEATURE(ARM_FEATURE_V8_PMULL, ARM_HWCAP2_ARM_PMULL);
-    GET_FEATURE(ARM_FEATURE_V8_SHA1, ARM_HWCAP2_ARM_SHA1);
-    GET_FEATURE(ARM_FEATURE_V8_SHA256, ARM_HWCAP2_ARM_SHA2);
-    GET_FEATURE(ARM_FEATURE_CRC, ARM_HWCAP2_ARM_CRC32);
+    GET_FEATURE_ID(aa32_aes, ARM_HWCAP2_ARM_AES);
+    GET_FEATURE_ID(aa32_pmull, ARM_HWCAP2_ARM_PMULL);
+    GET_FEATURE_ID(aa32_sha1, ARM_HWCAP2_ARM_SHA1);
+    GET_FEATURE_ID(aa32_sha2, ARM_HWCAP2_ARM_SHA2);
+    GET_FEATURE_ID(aa32_crc32, ARM_HWCAP2_ARM_CRC32);
     return hwcaps;
 }
 
 #undef GET_FEATURE
+#undef GET_FEATURE_ID
 
 #else
 /* 64 bit ARM definitions */
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
     /* probe for the extra features */
 #define GET_FEATURE(feat, hwcap) \
     do { if (arm_feature(&cpu->env, feat)) { hwcaps |= hwcap; } } while (0)
-    GET_FEATURE(ARM_FEATURE_V8_AES, ARM_HWCAP_A64_AES);
-    GET_FEATURE(ARM_FEATURE_V8_PMULL, ARM_HWCAP_A64_PMULL);
-    GET_FEATURE(ARM_FEATURE_V8_SHA1, ARM_HWCAP_A64_SHA1);
-    GET_FEATURE(ARM_FEATURE_V8_SHA256, ARM_HWCAP_A64_SHA2);
-    GET_FEATURE(ARM_FEATURE_CRC, ARM_HWCAP_A64_CRC32);
-    GET_FEATURE(ARM_FEATURE_V8_SHA3, ARM_HWCAP_A64_SHA3);
-    GET_FEATURE(ARM_FEATURE_V8_SM3, ARM_HWCAP_A64_SM3);
-    GET_FEATURE(ARM_FEATURE_V8_SM4, ARM_HWCAP_A64_SM4);
-    GET_FEATURE(ARM_FEATURE_V8_SHA512, ARM_HWCAP_A64_SHA512);
+#define GET_FEATURE_ID(feat, hwcap) \
+    do { if (cpu_isar_feature(feat, cpu)) { hwcaps |= hwcap; } } while (0)
+
+    GET_FEATURE_ID(aa64_aes, ARM_HWCAP_A64_AES);
+    GET_FEATURE_ID(aa64_pmull, ARM_HWCAP_A64_PMULL);
+    GET_FEATURE_ID(aa64_sha1, ARM_HWCAP_A64_SHA1);
+    GET_FEATURE_ID(aa64_sha256, ARM_HWCAP_A64_SHA2);
+    GET_FEATURE_ID(aa64_sha512, ARM_HWCAP_A64_SHA512);
+    GET_FEATURE_ID(aa64_crc32, ARM_HWCAP_A64_CRC32);
+    GET_FEATURE_ID(aa64_sha3, ARM_HWCAP_A64_SHA3);
+    GET_FEATURE_ID(aa64_sm3, ARM_HWCAP_A64_SM3);
+    GET_FEATURE_ID(aa64_sm4, ARM_HWCAP_A64_SM4);
     GET_FEATURE(ARM_FEATURE_V8_FP16,
                 ARM_HWCAP_A64_FPHP | ARM_HWCAP_A64_ASIMDHP);
-    GET_FEATURE(ARM_FEATURE_V8_ATOMICS, ARM_HWCAP_A64_ATOMICS);
-    GET_FEATURE(ARM_FEATURE_V8_RDM, ARM_HWCAP_A64_ASIMDRDM);
-    GET_FEATURE(ARM_FEATURE_V8_DOTPROD, ARM_HWCAP_A64_ASIMDDP);
-    GET_FEATURE(ARM_FEATURE_V8_FCMA, ARM_HWCAP_A64_FCMA);
+    GET_FEATURE_ID(aa64_atomics, ARM_HWCAP_A64_ATOMICS);
+    GET_FEATURE_ID(aa64_rdm, ARM_HWCAP_A64_ASIMDRDM);
+    GET_FEATURE_ID(aa64_dp, ARM_HWCAP_A64_ASIMDDP);
+    GET_FEATURE_ID(aa64_fcma, ARM_HWCAP_A64_FCMA);
     GET_FEATURE(ARM_FEATURE_SVE, ARM_HWCAP_A64_SVE);
+
 #undef GET_FEATURE
+#undef GET_FEATURE_ID
 
     return hwcaps;
 }
diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_max_initfn(Object *obj)
         cortex_a15_initfn(obj);
 #ifdef CONFIG_USER_ONLY
         /* We don't set these in system emulation mode for the moment,
-         * since we don't correctly set the ID registers to advertise them,
+         * since we don't correctly set (all of) the ID registers to
+         * advertise them.
          */
         set_feature(&cpu->env, ARM_FEATURE_V8);
-        set_feature(&cpu->env, ARM_FEATURE_V8_AES);
-        set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
-        set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
-        set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
-        set_feature(&cpu->env, ARM_FEATURE_CRC);
-        set_feature(&cpu->env, ARM_FEATURE_V8_RDM);
-        set_feature(&cpu->env, ARM_FEATURE_V8_DOTPROD);
-        set_feature(&cpu->env, ARM_FEATURE_V8_FCMA);
+        {
+            uint32_t t;
+
+            t = cpu->isar.id_isar5;
+            t = FIELD_DP32(t, ID_ISAR5, AES, 2);
+            t = FIELD_DP32(t, ID_ISAR5, SHA1, 1);
+            t = FIELD_DP32(t, ID_ISAR5, SHA2, 1);
+            t = FIELD_DP32(t, ID_ISAR5, CRC32, 1);
+            t = FIELD_DP32(t, ID_ISAR5, RDM, 1);
+            t = FIELD_DP32(t, ID_ISAR5, VCMA, 1);
+            cpu->isar.id_isar5 = t;
+
+            t = cpu->isar.id_isar6;
+            t = FIELD_DP32(t, ID_ISAR6, DP, 1);
+            cpu->isar.id_isar6 = t;
+        }
 #endif
     }
 }
diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu64.c
+++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_a57_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
     set_feature(&cpu->env, ARM_FEATURE_AARCH64);
     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
-    set_feature(&cpu->env, ARM_FEATURE_V8_AES);
-    set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
-    set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
-    set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
-    set_feature(&cpu->env, ARM_FEATURE_CRC);
     set_feature(&cpu->env, ARM_FEATURE_EL2);
     set_feature(&cpu->env, ARM_FEATURE_EL3);
     set_feature(&cpu->env, ARM_FEATURE_PMU);
@@ -XXX,XX +XXX,XX @@ static void aarch64_a53_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
     set_feature(&cpu->env, ARM_FEATURE_AARCH64);
     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
-    set_feature(&cpu->env, ARM_FEATURE_V8_AES);
-    set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
-    set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
-    set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
-    set_feature(&cpu->env, ARM_FEATURE_CRC);
     set_feature(&cpu->env, ARM_FEATURE_EL2);
     set_feature(&cpu->env, ARM_FEATURE_EL3);
     set_feature(&cpu->env, ARM_FEATURE_PMU);
@@ -XXX,XX +XXX,XX @@ static void aarch64_a72_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
     set_feature(&cpu->env, ARM_FEATURE_AARCH64);
     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
-    set_feature(&cpu->env, ARM_FEATURE_V8_AES);
-    set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
-    set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
-    set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
-    set_feature(&cpu->env, ARM_FEATURE_CRC);
     set_feature(&cpu->env, ARM_FEATURE_EL2);
     set_feature(&cpu->env, ARM_FEATURE_EL3);
     set_feature(&cpu->env, ARM_FEATURE_PMU);
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
     if (kvm_enabled()) {
         kvm_arm_set_cpu_features_from_host(cpu);
     } else {
+        uint64_t t;
+        uint32_t u;
         aarch64_a57_initfn(obj);
+
+        t = cpu->isar.id_aa64isar0;
+        t = FIELD_DP64(t, ID_AA64ISAR0, AES, 2); /* AES + PMULL */
+        t = FIELD_DP64(t, ID_AA64ISAR0, SHA1, 1);
+        t = FIELD_DP64(t, ID_AA64ISAR0, SHA2, 2); /* SHA512 */
+        t = FIELD_DP64(t, ID_AA64ISAR0, CRC32, 1);
+        t = FIELD_DP64(t, ID_AA64ISAR0, ATOMIC, 2);
+        t = FIELD_DP64(t, ID_AA64ISAR0, RDM, 1);
+        t = FIELD_DP64(t, ID_AA64ISAR0, SHA3, 1);
+        t = FIELD_DP64(t, ID_AA64ISAR0, SM3, 1);
+        t = FIELD_DP64(t, ID_AA64ISAR0, SM4, 1);
+        t = FIELD_DP64(t, ID_AA64ISAR0, DP, 1);
+        cpu->isar.id_aa64isar0 = t;
+
+        t = cpu->isar.id_aa64isar1;
+        t = FIELD_DP64(t, ID_AA64ISAR1, FCMA, 1);
+        cpu->isar.id_aa64isar1 = t;
+
+        /* Replicate the same data to the 32-bit id registers.  */
+        u = cpu->isar.id_isar5;
+        u = FIELD_DP32(u, ID_ISAR5, AES, 2); /* AES + PMULL */
+        u = FIELD_DP32(u, ID_ISAR5, SHA1, 1);
+        u = FIELD_DP32(u, ID_ISAR5, SHA2, 1);
+        u = FIELD_DP32(u, ID_ISAR5, CRC32, 1);
+        u = FIELD_DP32(u, ID_ISAR5, RDM, 1);
+        u = FIELD_DP32(u, ID_ISAR5, VCMA, 1);
+        cpu->isar.id_isar5 = u;
+
+        u = cpu->isar.id_isar6;
+        u = FIELD_DP32(u, ID_ISAR6, DP, 1);
+        cpu->isar.id_isar6 = u;
+
 #ifdef CONFIG_USER_ONLY
         /* We don't set these in system emulation mode for the moment,
          * since we don't correctly set the ID registers to advertise them,
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
          * whereas the architecture requires them to be present in both if
          * present in either.
          */
-        set_feature(&cpu->env, ARM_FEATURE_V8_SHA512);
-        set_feature(&cpu->env, ARM_FEATURE_V8_SHA3);
-        set_feature(&cpu->env, ARM_FEATURE_V8_SM3);
-        set_feature(&cpu->env, ARM_FEATURE_V8_SM4);
-        set_feature(&cpu->env, ARM_FEATURE_V8_ATOMICS);
-        set_feature(&cpu->env, ARM_FEATURE_V8_RDM);
-        set_feature(&cpu->env, ARM_FEATURE_V8_DOTPROD);
         set_feature(&cpu->env, ARM_FEATURE_V8_FP16);
-        set_feature(&cpu->env, ARM_FEATURE_V8_FCMA);
         set_feature(&cpu->env, ARM_FEATURE_SVE);
         /* For usermode -cpu max we can use a larger and more efficient DCZ
          * blocksize since we don't have to follow what the hardware does.
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
         }
         if (rt2 == 31
             && ((rt | rs) & 1) == 0
-            && arm_dc_feature(s, ARM_FEATURE_V8_ATOMICS)) {
+            && dc_isar_feature(aa64_atomics, s)) {
             /* CASP / CASPL */
             gen_compare_and_swap_pair(s, rs, rt, rn, size | 2);
             return;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
         }
         if (rt2 == 31
             && ((rt | rs) & 1) == 0
-            && arm_dc_feature(s, ARM_FEATURE_V8_ATOMICS)) {
+            && dc_isar_feature(aa64_atomics, s)) {
             /* CASPA / CASPAL */
             gen_compare_and_swap_pair(s, rs, rt, rn, size | 2);
             return;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
     case 0xb: /* CASL */
     case 0xe: /* CASA */
     case 0xf: /* CASAL */
-        if (rt2 == 31 && arm_dc_feature(s, ARM_FEATURE_V8_ATOMICS)) {
+        if (rt2 == 31 && dc_isar_feature(aa64_atomics, s)) {
             gen_compare_and_swap(s, rs, rt, rn, size);
             return;
         }
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_atomic(DisasContext *s, uint32_t insn,
     int rs = extract32(insn, 16, 5);
     int rn = extract32(insn, 5, 5);
     int o3_opc = extract32(insn, 12, 4);
-    int feature = ARM_FEATURE_V8_ATOMICS;
     TCGv_i64 tcg_rn, tcg_rs;
     AtomicThreeOpFn *fn;
 
-    if (is_vector) {
+    if (is_vector || !dc_isar_feature(aa64_atomics, s)) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_atomic(DisasContext *s, uint32_t insn,
         unallocated_encoding(s);
         return;
     }
-    if (!arm_dc_feature(s, feature)) {
-        unallocated_encoding(s);
-        return;
-    }
 
     if (rn == 31) {
         gen_check_sp_alignment(s);
@@ -XXX,XX +XXX,XX @@ static void handle_crc32(DisasContext *s,
     TCGv_i64 tcg_acc, tcg_val;
     TCGv_i32 tcg_bytes;
 
-    if (!arm_dc_feature(s, ARM_FEATURE_CRC)
+    if (!dc_isar_feature(aa64_crc32, s)
         || (sf == 1 && sz != 3)
         || (sf == 0 && sz == 3)) {
         unallocated_encoding(s);
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_three_reg_same_extra(DisasContext *s,
     bool u = extract32(insn, 29, 1);
     TCGv_i32 ele1, ele2, ele3;
     TCGv_i64 res;
-    int feature;
+    bool feature;
 
     switch (u * 16 + opcode) {
     case 0x10: /* SQRDMLAH (vector) */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_three_reg_same_extra(DisasContext *s,
             unallocated_encoding(s);
             return;
         }
-        feature = ARM_FEATURE_V8_RDM;
+        feature = dc_isar_feature(aa64_rdm, s);
         break;
     default:
         unallocated_encoding(s);
         return;
     }
-    if (!arm_dc_feature(s, feature)) {
+    if (!feature) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_diff(DisasContext *s, uint32_t insn)
             return;
         }
         if (size == 3) {
-            if (!arm_dc_feature(s, ARM_FEATURE_V8_PMULL)) {
+            if (!dc_isar_feature(aa64_pmull, s)) {
                 unallocated_encoding(s);
                 return;
             }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
     int size = extract32(insn, 22, 2);
     bool u = extract32(insn, 29, 1);
     bool is_q = extract32(insn, 30, 1);
-    int feature, rot;
+    bool feature;
+    int rot;
 
     switch (u * 16 + opcode) {
     case 0x10: /* SQRDMLAH (vector) */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
             unallocated_encoding(s);
             return;
         }
-        feature = ARM_FEATURE_V8_RDM;
+        feature = dc_isar_feature(aa64_rdm, s);
         break;
     case 0x02: /* SDOT (vector) */
     case 0x12: /* UDOT (vector) */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
             unallocated_encoding(s);
             return;
         }
-        feature = ARM_FEATURE_V8_DOTPROD;
+        feature = dc_isar_feature(aa64_dp, s);
         break;
     case 0x18: /* FCMLA, #0 */
     case 0x19: /* FCMLA, #90 */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
             unallocated_encoding(s);
             return;
         }
-        feature = ARM_FEATURE_V8_FCMA;
+        feature = dc_isar_feature(aa64_fcma, s);
         break;
     default:
         unallocated_encoding(s);
         return;
     }
-    if (!arm_dc_feature(s, feature)) {
+    if (!feature) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
         break;
     case 0x1d: /* SQRDMLAH */
     case 0x1f: /* SQRDMLSH */
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_RDM)) {
+        if (!dc_isar_feature(aa64_rdm, s)) {
             unallocated_encoding(s);
             return;
         }
         break;
     case 0x0e: /* SDOT */
     case 0x1e: /* UDOT */
-        if (size != MO_32 || !arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
+        if (size != MO_32 || !dc_isar_feature(aa64_dp, s)) {
             unallocated_encoding(s);
             return;
         }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
     case 0x13: /* FCMLA #90 */
     case 0x15: /* FCMLA #180 */
     case 0x17: /* FCMLA #270 */
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)) {
+        if (!dc_isar_feature(aa64_fcma, s)) {
             unallocated_encoding(s);
             return;
         }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_aes(DisasContext *s, uint32_t insn)
     TCGv_i32 tcg_decrypt;
     CryptoThreeOpIntFn *genfn;
 
-    if (!arm_dc_feature(s, ARM_FEATURE_V8_AES)
-        || size != 0) {
+    if (!dc_isar_feature(aa64_aes, s) || size != 0) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_sha(DisasContext *s, uint32_t insn)
     int rd = extract32(insn, 0, 5);
     CryptoThreeOpFn *genfn;
     TCGv_ptr tcg_rd_ptr, tcg_rn_ptr, tcg_rm_ptr;
-    int feature = ARM_FEATURE_V8_SHA256;
+    bool feature;
 
     if (size != 0) {
         unallocated_encoding(s);
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_sha(DisasContext *s, uint32_t insn)
     case 2: /* SHA1M */
     case 3: /* SHA1SU0 */
         genfn = NULL;
-        feature = ARM_FEATURE_V8_SHA1;
+        feature = dc_isar_feature(aa64_sha1, s);
         break;
     case 4: /* SHA256H */
         genfn = gen_helper_crypto_sha256h;
+        feature = dc_isar_feature(aa64_sha256, s);
         break;
     case 5: /* SHA256H2 */
         genfn = gen_helper_crypto_sha256h2;
+        feature = dc_isar_feature(aa64_sha256, s);
         break;
     case 6: /* SHA256SU1 */
         genfn = gen_helper_crypto_sha256su1;
+        feature = dc_isar_feature(aa64_sha256, s);
         break;
     default:
         unallocated_encoding(s);
         return;
     }
 
-    if (!arm_dc_feature(s, feature)) {
+    if (!feature) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha(DisasContext *s, uint32_t insn)
     int rn = extract32(insn, 5, 5);
     int rd = extract32(insn, 0, 5);
     CryptoTwoOpFn *genfn;
-    int feature;
+    bool feature;
     TCGv_ptr tcg_rd_ptr, tcg_rn_ptr;
 
     if (size != 0) {
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha(DisasContext *s, uint32_t insn)
 
     switch (opcode) {
     case 0: /* SHA1H */
-        feature = ARM_FEATURE_V8_SHA1;
+        feature = dc_isar_feature(aa64_sha1, s);
         genfn = gen_helper_crypto_sha1h;
         break;
     case 1: /* SHA1SU1 */
-        feature = ARM_FEATURE_V8_SHA1;
+        feature = dc_isar_feature(aa64_sha1, s);
         genfn = gen_helper_crypto_sha1su1;
         break;
     case 2: /* SHA256SU0 */
-        feature = ARM_FEATURE_V8_SHA256;
+        feature = dc_isar_feature(aa64_sha256, s);
         genfn = gen_helper_crypto_sha256su0;
         break;
     default:
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha(DisasContext *s, uint32_t insn)
         return;
     }
 
-    if (!arm_dc_feature(s, feature)) {
+    if (!feature) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_sha512(DisasContext *s, uint32_t insn)
     int rm = extract32(insn, 16, 5);
     int rn = extract32(insn, 5, 5);
     int rd = extract32(insn, 0, 5);
-    int feature;
+    bool feature;
     CryptoThreeOpFn *genfn;
 
     if (o == 0) {
         switch (opcode) {
         case 0: /* SHA512H */
-            feature = ARM_FEATURE_V8_SHA512;
+            feature = dc_isar_feature(aa64_sha512, s);
             genfn = gen_helper_crypto_sha512h;
             break;
         case 1: /* SHA512H2 */
-            feature = ARM_FEATURE_V8_SHA512;
+            feature = dc_isar_feature(aa64_sha512, s);
             genfn = gen_helper_crypto_sha512h2;
             break;
         case 2: /* SHA512SU1 */
-            feature = ARM_FEATURE_V8_SHA512;
+            feature = dc_isar_feature(aa64_sha512, s);
             genfn = gen_helper_crypto_sha512su1;
             break;
         case 3: /* RAX1 */
-            feature = ARM_FEATURE_V8_SHA3;
+            feature = dc_isar_feature(aa64_sha3, s);
             genfn = NULL;
             break;
         }
     } else {
         switch (opcode) {
         case 0: /* SM3PARTW1 */
-            feature = ARM_FEATURE_V8_SM3;
+            feature = dc_isar_feature(aa64_sm3, s);
             genfn = gen_helper_crypto_sm3partw1;
             break;
         case 1: /* SM3PARTW2 */
-            feature = ARM_FEATURE_V8_SM3;
+            feature = dc_isar_feature(aa64_sm3, s);
             genfn = gen_helper_crypto_sm3partw2;
             break;
         case 2: /* SM4EKEY */
-            feature = ARM_FEATURE_V8_SM4;
+            feature = dc_isar_feature(aa64_sm4, s);
             genfn = gen_helper_crypto_sm4ekey;
             break;
         default:
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_sha512(DisasContext *s, uint32_t insn)
         }
     }
 
-    if (!arm_dc_feature(s, feature)) {
+    if (!feature) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha512(DisasContext *s, uint32_t insn)
     int rn = extract32(insn, 5, 5);
     int rd = extract32(insn, 0, 5);
     TCGv_ptr tcg_rd_ptr, tcg_rn_ptr;
-    int feature;
+    bool feature;
     CryptoTwoOpFn *genfn;
 
     switch (opcode) {
     case 0: /* SHA512SU0 */
-        feature = ARM_FEATURE_V8_SHA512;
+        feature = dc_isar_feature(aa64_sha512, s);
         genfn = gen_helper_crypto_sha512su0;
         break;
     case 1: /* SM4E */
-        feature = ARM_FEATURE_V8_SM4;
+        feature = dc_isar_feature(aa64_sm4, s);
         genfn = gen_helper_crypto_sm4e;
         break;
     default:
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha512(DisasContext *s, uint32_t insn)
         return;
     }
 
-    if (!arm_dc_feature(s, feature)) {
+    if (!feature) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_four_reg(DisasContext *s, uint32_t insn)
     int ra = extract32(insn, 10, 5);
     int rn = extract32(insn, 5, 5);
     int rd = extract32(insn, 0, 5);
-    int feature;
+    bool feature;
 
     switch (op0) {
     case 0: /* EOR3 */
     case 1: /* BCAX */
-        feature = ARM_FEATURE_V8_SHA3;
+        feature = dc_isar_feature(aa64_sha3, s);
         break;
     case 2: /* SM3SS1 */
-        feature = ARM_FEATURE_V8_SM3;
+        feature = dc_isar_feature(aa64_sm3, s);
         break;
     default:
         unallocated_encoding(s);
         return;
     }
 
-    if (!arm_dc_feature(s, feature)) {
+    if (!feature) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_xar(DisasContext *s, uint32_t insn)
     TCGv_i64 tcg_op1, tcg_op2, tcg_res[2];
     int pass;
 
-    if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA3)) {
+    if (!dc_isar_feature(aa64_sha3, s)) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_imm2(DisasContext *s, uint32_t insn)
     TCGv_ptr tcg_rd_ptr, tcg_rn_ptr, tcg_rm_ptr;
     TCGv_i32 tcg_imm2, tcg_opcode;
 
-    if (!arm_dc_feature(s, ARM_FEATURE_V8_SM3)) {
+    if (!dc_isar_feature(aa64_sm3, s)) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_init_disas_context(DisasContextBase *dcbase,
     ARMCPU *arm_cpu = arm_env_get_cpu(env);
     int bound;
 
+    dc->isar = &arm_cpu->isar;
     dc->pc = dc->base.pc_first;
     dc->condjmp = 0;
 
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static const uint8_t neon_2rm_sizes[] = {
 static int do_v81_helper(DisasContext *s, gen_helper_gvec_3_ptr *fn,
                          int q, int rd, int rn, int rm)
 {
-    if (arm_dc_feature(s, ARM_FEATURE_V8_RDM)) {
+    if (dc_isar_feature(aa32_rdm, s)) {
         int opr_sz = (1 + q) * 8;
         tcg_gen_gvec_3_ptr(vfp_reg_offset(1, rd),
                            vfp_reg_offset(1, rn),
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 return 1;
             }
             if (!u) { /* SHA-1 */
-                if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA1)) {
+                if (!dc_isar_feature(aa32_sha1, s)) {
                     return 1;
                 }
                 ptr1 = vfp_reg_ptr(true, rd);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 gen_helper_crypto_sha1_3reg(ptr1, ptr2, ptr3, tmp4);
                 tcg_temp_free_i32(tmp4);
             } else { /* SHA-256 */
-                if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA256) || size == 3) {
+                if (!dc_isar_feature(aa32_sha2, s) || size == 3) {
                     return 1;
                 }
                 ptr1 = vfp_reg_ptr(true, rd);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 if (op == 14 && size == 2) {
                     TCGv_i64 tcg_rn, tcg_rm, tcg_rd;
 
-                    if (!arm_dc_feature(s, ARM_FEATURE_V8_PMULL)) {
+                    if (!dc_isar_feature(aa32_pmull, s)) {
                         return 1;
                     }
                     tcg_rn = tcg_temp_new_i64();
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                     {
                         NeonGenThreeOpEnvFn *fn;
 
-                        if (!arm_dc_feature(s, ARM_FEATURE_V8_RDM)) {
+                        if (!dc_isar_feature(aa32_rdm, s)) {
                             return 1;
                         }
                         if (u && ((rd | rn) & 1)) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                     break;
                 }
                 case NEON_2RM_AESE: case NEON_2RM_AESMC:
-                    if (!arm_dc_feature(s, ARM_FEATURE_V8_AES)
-                        || ((rm | rd) & 1)) {
+                    if (!dc_isar_feature(aa32_aes, s) || ((rm | rd) & 1)) {
                         return 1;
                     }
                     ptr1 = vfp_reg_ptr(true, rd);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                     tcg_temp_free_i32(tmp3);
                     break;
                 case NEON_2RM_SHA1H:
-                    if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA1)
-                        || ((rm | rd) & 1)) {
+                    if (!dc_isar_feature(aa32_sha1, s) || ((rm | rd) & 1)) {
                         return 1;
                     }
                     ptr1 = vfp_reg_ptr(true, rd);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                     }
                     /* bit 6 (q): set -> SHA256SU0, cleared -> SHA1SU1 */
                     if (q) {
-                        if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA256)) {
+                        if (!dc_isar_feature(aa32_sha2, s)) {
                             return 1;
                         }
-                    } else if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA1)) {
+                    } else if (!dc_isar_feature(aa32_sha1, s)) {
                         return 1;
                     }
                     ptr1 = vfp_reg_ptr(true, rd);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
         /* VCMLA -- 1111 110R R.1S .... .... 1000 ...0 .... */
         int size = extract32(insn, 20, 1);
         data = extract32(insn, 23, 2); /* rot */
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)
+        if (!dc_isar_feature(aa32_vcma, s)
             || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
             return 1;
         }
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
         /* VCADD -- 1111 110R 1.0S .... .... 1000 ...0 .... */
         int size = extract32(insn, 20, 1);
         data = extract32(insn, 24, 1); /* rot */
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)
+        if (!dc_isar_feature(aa32_vcma, s)
             || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
             return 1;
         }
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
     } else if ((insn & 0xfeb00f00) == 0xfc200d00) {
         /* V[US]DOT -- 1111 1100 0.10 .... .... 1101 .Q.U .... */
         bool u = extract32(insn, 4, 1);
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
+        if (!dc_isar_feature(aa32_dp, s)) {
             return 1;
         }
         fn_gvec = u ? gen_helper_gvec_udot_b : gen_helper_gvec_sdot_b;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
         int size = extract32(insn, 23, 1);
         int index;
 
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)) {
+        if (!dc_isar_feature(aa32_vcma, s)) {
             return 1;
         }
         if (size == 0) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
     } else if ((insn & 0xffb00f00) == 0xfe200d00) {
         /* V[US]DOT -- 1111 1110 0.10 .... .... 1101 .Q.U .... */
         int u = extract32(insn, 4, 1);
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
+        if (!dc_isar_feature(aa32_dp, s)) {
             return 1;
         }
         fn_gvec = u ? gen_helper_gvec_udot_idx_b : gen_helper_gvec_sdot_idx_b;
@@ -XXX,XX +XXX,XX @@ static void disas_arm_insn(DisasContext *s, unsigned int insn)
              * op1 == 3 is UNPREDICTABLE but handle as UNDEFINED.
              * Bits 8, 10 and 11 should be zero.
              */
-            if (!arm_dc_feature(s, ARM_FEATURE_CRC) || op1 == 0x3 ||
-                (c & 0xd) != 0) {
+            if (!dc_isar_feature(aa32_crc32, s) || op1 == 0x3 || (c & 0xd) != 0) {
                 goto illegal_op;
             }
 
@@ -XXX,XX +XXX,XX @@ static void disas_thumb2_insn(DisasContext *s, uint32_t insn)
                 case 0x28:
                 case 0x29:
                 case 0x2a:
-                    if (!arm_dc_feature(s, ARM_FEATURE_CRC)) {
+                    if (!dc_isar_feature(aa32_crc32, s)) {
                         goto illegal_op;
                     }
                     break;
@@ -XXX,XX +XXX,XX @@ static void arm_tr_init_disas_context(DisasContextBase *dcbase, CPUState *cs)
     CPUARMState *env = cs->env_ptr;
     ARMCPU *cpu = arm_env_get_cpu(env);
 
+    dc->isar = &cpu->isar;
     dc->pc = dc->base.pc_first;
     dc->condjmp = 0;
 
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Both arm and thumb2 division are controlled by the same ISAR field,
which takes care of the arm implies thumb case.  Having M imply
thumb2 division was wrong for cortex-m0, which is v6m and does not
have thumb2 at all, much less thumb2 division.

Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181016223115.24100-5-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h       | 12 ++++++++++--
 linux-user/elfload.c   |  4 ++--
 target/arm/cpu.c       | 10 +---------
 target/arm/translate.c |  4 ++--
 4 files changed, 15 insertions(+), 15 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ enum arm_features {
     ARM_FEATURE_VFP3,
     ARM_FEATURE_VFP_FP16,
     ARM_FEATURE_NEON,
-    ARM_FEATURE_THUMB_DIV, /* divide supported in Thumb encoding */
     ARM_FEATURE_M, /* Microcontroller profile.  */
     ARM_FEATURE_OMAPCP, /* OMAP specific CP15 ops handling.  */
     ARM_FEATURE_THUMB2EE,
@@ -XXX,XX +XXX,XX @@ enum arm_features {
     ARM_FEATURE_V5,
     ARM_FEATURE_STRONGARM,
     ARM_FEATURE_VAPA, /* cp15 VA to PA lookups */
-    ARM_FEATURE_ARM_DIV, /* divide supported in ARM encoding */
     ARM_FEATURE_VFP4, /* VFPv4 (implies that NEON is v2) */
     ARM_FEATURE_GENERIC_TIMER,
     ARM_FEATURE_MVFR, /* Media and VFP Feature Registers 0 and 1 */
@@ -XXX,XX +XXX,XX @@ extern const uint64_t pred_esz_masks[4];
 /*
  * 32-bit feature tests via id registers.
  */
+static inline bool isar_feature_thumb_div(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar0, ID_ISAR0, DIVIDE) != 0;
+}
+
+static inline bool isar_feature_arm_div(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar0, ID_ISAR0, DIVIDE) > 1;
+}
+
 static inline bool isar_feature_aa32_aes(const ARMISARegisters *id)
 {
     return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) != 0;
diff --git a/linux-user/elfload.c b/linux-user/elfload.c
index XXXXXXX..XXXXXXX 100644
--- a/linux-user/elfload.c
+++ b/linux-user/elfload.c
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
     GET_FEATURE(ARM_FEATURE_VFP3, ARM_HWCAP_ARM_VFPv3);
     GET_FEATURE(ARM_FEATURE_V6K, ARM_HWCAP_ARM_TLS);
     GET_FEATURE(ARM_FEATURE_VFP4, ARM_HWCAP_ARM_VFPv4);
-    GET_FEATURE(ARM_FEATURE_ARM_DIV, ARM_HWCAP_ARM_IDIVA);
-    GET_FEATURE(ARM_FEATURE_THUMB_DIV, ARM_HWCAP_ARM_IDIVT);
+    GET_FEATURE_ID(arm_div, ARM_HWCAP_ARM_IDIVA);
+    GET_FEATURE_ID(thumb_div, ARM_HWCAP_ARM_IDIVT);
     /* All QEMU's VFPv3 CPUs have 32 registers, see VFP_DREG in translate.c.
      * Note that the ARM_HWCAP_ARM_VFPv3D16 bit is always the inverse of
      * ARM_HWCAP_ARM_VFPD32 (and so always clear for QEMU); it is unrelated
diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
          * Presence of EL2 itself is ARM_FEATURE_EL2, and of the
          * Security Extensions is ARM_FEATURE_EL3.
          */
-        set_feature(env, ARM_FEATURE_ARM_DIV);
+        assert(cpu_isar_feature(arm_div, cpu));
         set_feature(env, ARM_FEATURE_LPAE);
         set_feature(env, ARM_FEATURE_V7);
     }
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
     if (arm_feature(env, ARM_FEATURE_V5)) {
         set_feature(env, ARM_FEATURE_V4T);
     }
-    if (arm_feature(env, ARM_FEATURE_M)) {
-        set_feature(env, ARM_FEATURE_THUMB_DIV);
-    }
-    if (arm_feature(env, ARM_FEATURE_ARM_DIV)) {
-        set_feature(env, ARM_FEATURE_THUMB_DIV);
-    }
     if (arm_feature(env, ARM_FEATURE_VFP4)) {
         set_feature(env, ARM_FEATURE_VFP3);
         set_feature(env, ARM_FEATURE_VFP_FP16);
@@ -XXX,XX +XXX,XX @@ static void cortex_r5_initfn(Object *obj)
     ARMCPU *cpu = ARM_CPU(obj);
 
     set_feature(&cpu->env, ARM_FEATURE_V7);
-    set_feature(&cpu->env, ARM_FEATURE_THUMB_DIV);
-    set_feature(&cpu->env, ARM_FEATURE_ARM_DIV);
     set_feature(&cpu->env, ARM_FEATURE_V7MP);
     set_feature(&cpu->env, ARM_FEATURE_PMSA);
     cpu->midr = 0x411fc153; /* r1p3 */
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void disas_arm_insn(DisasContext *s, unsigned int insn)
                     case 1:
                     case 3:
                         /* SDIV, UDIV */
-                        if (!arm_dc_feature(s, ARM_FEATURE_ARM_DIV)) {
+                        if (!dc_isar_feature(arm_div, s)) {
                             goto illegal_op;
                         }
                         if (((insn >> 5) & 7) || (rd != 15)) {
@@ -XXX,XX +XXX,XX @@ static void disas_thumb2_insn(DisasContext *s, uint32_t insn)
             tmp2 = load_reg(s, rm);
             if ((op & 0x50) == 0x10) {
                 /* sdiv, udiv */
-                if (!arm_dc_feature(s, ARM_FEATURE_THUMB_DIV)) {
+                if (!dc_isar_feature(thumb_div, s)) {
                     goto illegal_op;
                 }
                 if (op & 0x20)
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Having V6 alone imply jazelle was wrong for cortex-m0.
Change to an assertion for V6 & !M.

This was harmless, because the only place we tested ARM_FEATURE_JAZELLE
was for 'bxj' in disas_arm(), which is unreachable for M-profile cores.

Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181016223115.24100-6-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h       |  6 +++++-
 target/arm/cpu.c       | 17 ++++++++++++++---
 target/arm/translate.c |  2 +-
 3 files changed, 20 insertions(+), 5 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181016223115.24100-7-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h     | 6 +++++-
 linux-user/elfload.c | 2 +-
 target/arm/cpu.c     | 4 ----
 target/arm/helper.c  | 2 +-
 target/arm/machine.c | 3 +--
 5 files changed, 8 insertions(+), 9 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ enum arm_features {
     ARM_FEATURE_NEON,
     ARM_FEATURE_M, /* Microcontroller profile.  */
     ARM_FEATURE_OMAPCP, /* OMAP specific CP15 ops handling.  */
-    ARM_FEATURE_THUMB2EE,
     ARM_FEATURE_V7MP,    /* v7 Multiprocessing Extensions */
     ARM_FEATURE_V7VE, /* v7 Virtualization Extensions (non-EL2 parts) */
     ARM_FEATURE_V4T,
@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_jazelle(const ARMISARegisters *id)
     return FIELD_EX32(id->id_isar1, ID_ISAR1, JAZELLE) != 0;
 }
 
+static inline bool isar_feature_t32ee(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar3, ID_ISAR3, T32EE) != 0;
+}
+
 static inline bool isar_feature_aa32_aes(const ARMISARegisters *id)
 {
     return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) != 0;
diff --git a/linux-user/elfload.c b/linux-user/elfload.c
index XXXXXXX..XXXXXXX 100644
--- a/linux-user/elfload.c
+++ b/linux-user/elfload.c
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
     GET_FEATURE(ARM_FEATURE_V5, ARM_HWCAP_ARM_EDSP);
     GET_FEATURE(ARM_FEATURE_VFP, ARM_HWCAP_ARM_VFP);
     GET_FEATURE(ARM_FEATURE_IWMMXT, ARM_HWCAP_ARM_IWMMXT);
-    GET_FEATURE(ARM_FEATURE_THUMB2EE, ARM_HWCAP_ARM_THUMBEE);
+    GET_FEATURE_ID(t32ee, ARM_HWCAP_ARM_THUMBEE);
     GET_FEATURE(ARM_FEATURE_NEON, ARM_HWCAP_ARM_NEON);
     GET_FEATURE(ARM_FEATURE_VFP3, ARM_HWCAP_ARM_VFPv3);
     GET_FEATURE(ARM_FEATURE_V6K, ARM_HWCAP_ARM_TLS);
diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void cortex_a8_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_V7);
     set_feature(&cpu->env, ARM_FEATURE_VFP3);
     set_feature(&cpu->env, ARM_FEATURE_NEON);
-    set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
     set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
     set_feature(&cpu->env, ARM_FEATURE_EL3);
     cpu->midr = 0x410fc080;
@@ -XXX,XX +XXX,XX @@ static void cortex_a9_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_VFP3);
     set_feature(&cpu->env, ARM_FEATURE_VFP_FP16);
     set_feature(&cpu->env, ARM_FEATURE_NEON);
-    set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
     set_feature(&cpu->env, ARM_FEATURE_EL3);
     /* Note that A9 supports the MP extensions even for
      * A9UP and single-core A9MP (which are both different
@@ -XXX,XX +XXX,XX @@ static void cortex_a7_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_V7VE);
     set_feature(&cpu->env, ARM_FEATURE_VFP4);
     set_feature(&cpu->env, ARM_FEATURE_NEON);
-    set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
     set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
@@ -XXX,XX +XXX,XX @@ static void cortex_a15_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_V7VE);
     set_feature(&cpu->env, ARM_FEATURE_VFP4);
     set_feature(&cpu->env, ARM_FEATURE_NEON);
-    set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
     set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
         define_arm_cp_regs(cpu, vmsa_pmsa_cp_reginfo);
         define_arm_cp_regs(cpu, vmsa_cp_reginfo);
     }
-    if (arm_feature(env, ARM_FEATURE_THUMB2EE)) {
+    if (cpu_isar_feature(t32ee, cpu)) {
         define_arm_cp_regs(cpu, t2ee_cp_reginfo);
     }
     if (arm_feature(env, ARM_FEATURE_GENERIC_TIMER)) {
diff --git a/target/arm/machine.c b/target/arm/machine.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/machine.c
+++ b/target/arm/machine.c
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_m = {
 static bool thumb2ee_needed(void *opaque)
 {
     ARMCPU *cpu = opaque;
-    CPUARMState *env = &cpu->env;
 
-    return arm_feature(env, ARM_FEATURE_THUMB2EE);
+    return cpu_isar_feature(t32ee, cpu);
 }
 
 static const VMStateDescription vmstate_thumb2ee = {
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181016223115.24100-8-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h            | 16 +++++++++++++++-
 linux-user/aarch64/signal.c |  4 ++--
 linux-user/elfload.c        |  2 +-
 linux-user/syscall.c        | 10 ++++++----
 target/arm/cpu64.c          |  5 ++++-
 target/arm/helper.c         |  9 ++++++---
 target/arm/machine.c        |  3 +--
 target/arm/translate-a64.c  |  4 ++--
 8 files changed, 37 insertions(+), 16 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ FIELD(ID_AA64ISAR1, FRINTTS, 32, 4)
 FIELD(ID_AA64ISAR1, SB, 36, 4)
 FIELD(ID_AA64ISAR1, SPECRES, 40, 4)
 
+FIELD(ID_AA64PFR0, EL0, 0, 4)
+FIELD(ID_AA64PFR0, EL1, 4, 4)
+FIELD(ID_AA64PFR0, EL2, 8, 4)
+FIELD(ID_AA64PFR0, EL3, 12, 4)
+FIELD(ID_AA64PFR0, FP, 16, 4)
+FIELD(ID_AA64PFR0, ADVSIMD, 20, 4)
+FIELD(ID_AA64PFR0, GIC, 24, 4)
+FIELD(ID_AA64PFR0, RAS, 28, 4)
+FIELD(ID_AA64PFR0, SVE, 32, 4)
+
 QEMU_BUILD_BUG_ON(ARRAY_SIZE(((ARMCPU *)0)->ccsidr) <= R_V7M_CSSELR_INDEX_MASK);
 
 /* If adding a feature bit which corresponds to a Linux ELF
@@ -XXX,XX +XXX,XX @@ enum arm_features {
     ARM_FEATURE_PMU, /* has PMU support */
     ARM_FEATURE_VBAR, /* has cp15 VBAR */
     ARM_FEATURE_M_SECURITY, /* M profile Security Extension */
-    ARM_FEATURE_SVE, /* has Scalable Vector Extension */
     ARM_FEATURE_V8_FP16, /* implements v8.2 half-precision float */
     ARM_FEATURE_M_MAIN, /* M profile Main Extension */
 };
@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_aa64_fcma(const ARMISARegisters *id)
     return FIELD_EX64(id->id_aa64isar1, ID_AA64ISAR1, FCMA) != 0;
 }
 
+static inline bool isar_feature_aa64_sve(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64pfr0, ID_AA64PFR0, SVE) != 0;
+}
+
 /*
  * Forward to the above feature tests given an ARMCPU pointer.
  */
diff --git a/linux-user/aarch64/signal.c b/linux-user/aarch64/signal.c
index XXXXXXX..XXXXXXX 100644
--- a/linux-user/aarch64/signal.c
+++ b/linux-user/aarch64/signal.c
@@ -XXX,XX +XXX,XX @@ static int target_restore_sigframe(CPUARMState *env,
             break;
 
         case TARGET_SVE_MAGIC:
-            if (arm_feature(env, ARM_FEATURE_SVE)) {
+            if (cpu_isar_feature(aa64_sve, arm_env_get_cpu(env))) {
                 vq = (env->vfp.zcr_el[1] & 0xf) + 1;
                 sve_size = QEMU_ALIGN_UP(TARGET_SVE_SIG_CONTEXT_SIZE(vq), 16);
                 if (!sve && size == sve_size) {
@@ -XXX,XX +XXX,XX @@ static void target_setup_frame(int usig, struct target_sigaction *ka,
                                       &layout);
 
     /* SVE state needs saving only if it exists.  */
-    if (arm_feature(env, ARM_FEATURE_SVE)) {
+    if (cpu_isar_feature(aa64_sve, arm_env_get_cpu(env))) {
         vq = (env->vfp.zcr_el[1] & 0xf) + 1;
         sve_size = QEMU_ALIGN_UP(TARGET_SVE_SIG_CONTEXT_SIZE(vq), 16);
         sve_ofs = alloc_sigframe_space(sve_size, &layout);
diff --git a/linux-user/elfload.c b/linux-user/elfload.c
index XXXXXXX..XXXXXXX 100644
--- a/linux-user/elfload.c
+++ b/linux-user/elfload.c
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
     GET_FEATURE_ID(aa64_rdm, ARM_HWCAP_A64_ASIMDRDM);
     GET_FEATURE_ID(aa64_dp, ARM_HWCAP_A64_ASIMDDP);
     GET_FEATURE_ID(aa64_fcma, ARM_HWCAP_A64_FCMA);
-    GET_FEATURE(ARM_FEATURE_SVE, ARM_HWCAP_A64_SVE);
+    GET_FEATURE_ID(aa64_sve, ARM_HWCAP_A64_SVE);
 
 #undef GET_FEATURE
 #undef GET_FEATURE_ID
diff --git a/linux-user/syscall.c b/linux-user/syscall.c
index XXXXXXX..XXXXXXX 100644
--- a/linux-user/syscall.c
+++ b/linux-user/syscall.c
@@ -XXX,XX +XXX,XX @@ static abi_long do_syscall1(void *cpu_env, int num, abi_long arg1,
              * even though the current architectural maximum is VQ=16.
              */
             ret = -TARGET_EINVAL;
-            if (arm_feature(cpu_env, ARM_FEATURE_SVE)
+            if (cpu_isar_feature(aa64_sve, arm_env_get_cpu(cpu_env))
                 && arg2 >= 0 && arg2 <= 512 * 16 && !(arg2 & 15)) {
                 CPUARMState *env = cpu_env;
                 ARMCPU *cpu = arm_env_get_cpu(env);
@@ -XXX,XX +XXX,XX @@ static abi_long do_syscall1(void *cpu_env, int num, abi_long arg1,
             return ret;
         case TARGET_PR_SVE_GET_VL:
             ret = -TARGET_EINVAL;
-            if (arm_feature(cpu_env, ARM_FEATURE_SVE)) {
-                CPUARMState *env = cpu_env;
-                ret = ((env->vfp.zcr_el[1] & 0xf) + 1) * 16;
+            {
+                ARMCPU *cpu = arm_env_get_cpu(cpu_env);
+                if (cpu_isar_feature(aa64_sve, cpu)) {
+                    ret = ((cpu->env.vfp.zcr_el[1] & 0xf) + 1) * 16;
+                }
             }
             return ret;
 #endif /* AARCH64 */
diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu64.c
+++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
         t = FIELD_DP64(t, ID_AA64ISAR1, FCMA, 1);
         cpu->isar.id_aa64isar1 = t;
 
+        t = cpu->isar.id_aa64pfr0;
+        t = FIELD_DP64(t, ID_AA64PFR0, SVE, 1);
+        cpu->isar.id_aa64pfr0 = t;
+
         /* Replicate the same data to the 32-bit id registers.  */
         u = cpu->isar.id_isar5;
         u = FIELD_DP32(u, ID_ISAR5, AES, 2); /* AES + PMULL */
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
          * present in either.
          */
         set_feature(&cpu->env, ARM_FEATURE_V8_FP16);
-        set_feature(&cpu->env, ARM_FEATURE_SVE);
         /* For usermode -cpu max we can use a larger and more efficient DCZ
          * blocksize since we don't have to follow what the hardware does.
          */
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
         define_one_arm_cp_reg(cpu, &sctlr);
     }
 
-    if (arm_feature(env, ARM_FEATURE_SVE)) {
+    if (cpu_isar_feature(aa64_sve, cpu)) {
         define_one_arm_cp_reg(cpu, &zcr_el1_reginfo);
         if (arm_feature(env, ARM_FEATURE_EL2)) {
             define_one_arm_cp_reg(cpu, &zcr_el2_reginfo);
@@ -XXX,XX +XXX,XX @@ void cpu_get_tb_cpu_state(CPUARMState *env, target_ulong *pc,
     uint32_t flags;
 
     if (is_a64(env)) {
+        ARMCPU *cpu = arm_env_get_cpu(env);
+
         *pc = env->pc;
         flags = ARM_TBFLAG_AARCH64_STATE_MASK;
         /* Get control bits for tagged addresses */
         flags |= (arm_regime_tbi0(env, mmu_idx) << ARM_TBFLAG_TBI0_SHIFT);
         flags |= (arm_regime_tbi1(env, mmu_idx) << ARM_TBFLAG_TBI1_SHIFT);
 
-        if (arm_feature(env, ARM_FEATURE_SVE)) {
+        if (cpu_isar_feature(aa64_sve, cpu)) {
             int sve_el = sve_exception_el(env, current_el);
             uint32_t zcr_len;
 
@@ -XXX,XX +XXX,XX @@ void aarch64_sve_narrow_vq(CPUARMState *env, unsigned vq)
 void aarch64_sve_change_el(CPUARMState *env, int old_el,
                            int new_el, bool el0_a64)
 {
+    ARMCPU *cpu = arm_env_get_cpu(env);
     int old_len, new_len;
     bool old_a64, new_a64;
 
     /* Nothing to do if no SVE.  */
-    if (!arm_feature(env, ARM_FEATURE_SVE)) {
+    if (!cpu_isar_feature(aa64_sve, cpu)) {
         return;
     }
 
diff --git a/target/arm/machine.c b/target/arm/machine.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/machine.c
+++ b/target/arm/machine.c
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_iwmmxt = {
 static bool sve_needed(void *opaque)
 {
     ARMCPU *cpu = opaque;
-    CPUARMState *env = &cpu->env;
 
-    return arm_feature(env, ARM_FEATURE_SVE);
+    return cpu_isar_feature(aa64_sve, cpu);
 }
 
 /* The first two words of each Zreg is stored in VFP state.  */
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ void aarch64_cpu_dump_state(CPUState *cs, FILE *f,
     cpu_fprintf(f, "     FPCR=%08x FPSR=%08x\n",
                 vfp_get_fpcr(env), vfp_get_fpsr(env));
 
-    if (arm_feature(env, ARM_FEATURE_SVE) && sve_exception_el(env, el) == 0) {
+    if (cpu_isar_feature(aa64_sve, cpu) && sve_exception_el(env, el) == 0) {
         int j, zcr_len = sve_zcr_len_for_el(env, el);
 
         for (i = 0; i <= FFR_PRED_NUM; i++) {
@@ -XXX,XX +XXX,XX @@ static void disas_a64_insn(CPUARMState *env, DisasContext *s)
         unallocated_encoding(s);
         break;
     case 0x2:
-        if (!arm_dc_feature(s, ARM_FEATURE_SVE) || !disas_sve(s, insn)) {
+        if (!dc_isar_feature(aa64_sve, s) || !disas_sve(s, insn)) {
             unallocated_encoding(s);
         }
         break;
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181016223115.24100-9-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h           | 17 +++++++++++++++-
 linux-user/elfload.c       |  6 +-----
 target/arm/cpu64.c         | 16 ++++++++-------
 target/arm/helper.c        |  2 +-
 target/arm/translate-a64.c | 40 +++++++++++++++++++-------------------
 target/arm/translate.c     |  6 +++---
 6 files changed, 50 insertions(+), 37 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ enum arm_features {
     ARM_FEATURE_PMU, /* has PMU support */
     ARM_FEATURE_VBAR, /* has cp15 VBAR */
     ARM_FEATURE_M_SECURITY, /* M profile Security Extension */
-    ARM_FEATURE_V8_FP16, /* implements v8.2 half-precision float */
     ARM_FEATURE_M_MAIN, /* M profile Main Extension */
 };
 
@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_aa32_dp(const ARMISARegisters *id)
     return FIELD_EX32(id->id_isar6, ID_ISAR6, DP) != 0;
 }
 
+static inline bool isar_feature_aa32_fp16_arith(const ARMISARegisters *id)
+{
+    /*
+     * This is a placeholder for use by VCMA until the rest of
+     * the ARMv8.2-FP16 extension is implemented for aa32 mode.
+     * At which point we can properly set and check MVFR1.FPHP.
+     */
+    return FIELD_EX64(id->id_aa64pfr0, ID_AA64PFR0, FP) == 1;
+}
+
 /*
  * 64-bit feature tests via id registers.
  */
@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_aa64_fcma(const ARMISARegisters *id)
     return FIELD_EX64(id->id_aa64isar1, ID_AA64ISAR1, FCMA) != 0;
 }
 
+static inline bool isar_feature_aa64_fp16(const ARMISARegisters *id)
+{
+    /* We always set the AdvSIMD and FP fields identically wrt FP16.  */
+    return FIELD_EX64(id->id_aa64pfr0, ID_AA64PFR0, FP) == 1;
+}
+
 static inline bool isar_feature_aa64_sve(const ARMISARegisters *id)
 {
     return FIELD_EX64(id->id_aa64pfr0, ID_AA64PFR0, SVE) != 0;
diff --git a/linux-user/elfload.c b/linux-user/elfload.c
index XXXXXXX..XXXXXXX 100644
--- a/linux-user/elfload.c
+++ b/linux-user/elfload.c
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
     hwcaps |= ARM_HWCAP_A64_ASIMD;
 
     /* probe for the extra features */
-#define GET_FEATURE(feat, hwcap) \
-    do { if (arm_feature(&cpu->env, feat)) { hwcaps |= hwcap; } } while (0)
 #define GET_FEATURE_ID(feat, hwcap) \
     do { if (cpu_isar_feature(feat, cpu)) { hwcaps |= hwcap; } } while (0)
 
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
     GET_FEATURE_ID(aa64_sha3, ARM_HWCAP_A64_SHA3);
     GET_FEATURE_ID(aa64_sm3, ARM_HWCAP_A64_SM3);
     GET_FEATURE_ID(aa64_sm4, ARM_HWCAP_A64_SM4);
-    GET_FEATURE(ARM_FEATURE_V8_FP16,
-                ARM_HWCAP_A64_FPHP | ARM_HWCAP_A64_ASIMDHP);
+    GET_FEATURE_ID(aa64_fp16, ARM_HWCAP_A64_FPHP | ARM_HWCAP_A64_ASIMDHP);
     GET_FEATURE_ID(aa64_atomics, ARM_HWCAP_A64_ATOMICS);
     GET_FEATURE_ID(aa64_rdm, ARM_HWCAP_A64_ASIMDRDM);
     GET_FEATURE_ID(aa64_dp, ARM_HWCAP_A64_ASIMDDP);
     GET_FEATURE_ID(aa64_fcma, ARM_HWCAP_A64_FCMA);
     GET_FEATURE_ID(aa64_sve, ARM_HWCAP_A64_SVE);
 
-#undef GET_FEATURE
 #undef GET_FEATURE_ID
 
     return hwcaps;
diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu64.c
+++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
 
         t = cpu->isar.id_aa64pfr0;
         t = FIELD_DP64(t, ID_AA64PFR0, SVE, 1);
+        t = FIELD_DP64(t, ID_AA64PFR0, FP, 1);
+        t = FIELD_DP64(t, ID_AA64PFR0, ADVSIMD, 1);
         cpu->isar.id_aa64pfr0 = t;
 
         /* Replicate the same data to the 32-bit id registers.  */
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
         u = FIELD_DP32(u, ID_ISAR6, DP, 1);
         cpu->isar.id_isar6 = u;
 
-#ifdef CONFIG_USER_ONLY
-        /* We don't set these in system emulation mode for the moment,
-         * since we don't correctly set the ID registers to advertise them,
-         * and in some cases they're only available in AArch64 and not AArch32,
-         * whereas the architecture requires them to be present in both if
-         * present in either.
+        /*
+         * FIXME: We do not yet support ARMv8.2-fp16 for AArch32 yet,
+         * so do not set MVFR1.FPHP.  Strictly speaking this is not legal,
+         * but it is also not legal to enable SVE without support for FP16,
+         * and enabling SVE in system mode is more useful in the short term.
          */
-        set_feature(&cpu->env, ARM_FEATURE_V8_FP16);
+
+#ifdef CONFIG_USER_ONLY
         /* For usermode -cpu max we can use a larger and more efficient DCZ
          * blocksize since we don't have to follow what the hardware does.
          */
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(vfp_set_fpscr)(CPUARMState *env, uint32_t val)
     uint32_t changed;
 
     /* When ARMv8.2-FP16 is not supported, FZ16 is RES0.  */
-    if (!arm_feature(env, ARM_FEATURE_V8_FP16)) {
+    if (!cpu_isar_feature(aa64_fp16, arm_env_get_cpu(env))) {
         val &= ~FPCR_FZ16;
     }
 
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_fp_compare(DisasContext *s, uint32_t insn)
         break;
     case 3:
         size = MO_16;
-        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (dc_isar_feature(aa64_fp16, s)) {
             break;
         }
         /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_ccomp(DisasContext *s, uint32_t insn)
         break;
     case 3:
         size = MO_16;
-        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (dc_isar_feature(aa64_fp16, s)) {
             break;
         }
         /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_csel(DisasContext *s, uint32_t insn)
         break;
     case 3:
         sz = MO_16;
-        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (dc_isar_feature(aa64_fp16, s)) {
             break;
         }
         /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_1src(DisasContext *s, uint32_t insn)
             handle_fp_1src_double(s, opcode, rd, rn);
             break;
         case 3:
-            if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+            if (!dc_isar_feature(aa64_fp16, s)) {
                 unallocated_encoding(s);
                 return;
             }
@@ -XXX,XX +XXX,XX @@ static void disas_fp_2src(DisasContext *s, uint32_t insn)
         handle_fp_2src_double(s, opcode, rd, rn, rm);
         break;
     case 3:
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (!dc_isar_feature(aa64_fp16, s)) {
             unallocated_encoding(s);
             return;
         }
@@ -XXX,XX +XXX,XX @@ static void disas_fp_3src(DisasContext *s, uint32_t insn)
         handle_fp_3src_double(s, o0, o1, rd, rn, rm, ra);
         break;
     case 3:
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (!dc_isar_feature(aa64_fp16, s)) {
             unallocated_encoding(s);
             return;
         }
@@ -XXX,XX +XXX,XX @@ static void disas_fp_imm(DisasContext *s, uint32_t insn)
         break;
     case 3:
         sz = MO_16;
-        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (dc_isar_feature(aa64_fp16, s)) {
             break;
         }
         /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_fixed_conv(DisasContext *s, uint32_t insn)
     case 1: /* float64 */
         break;
     case 3: /* float16 */
-        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (dc_isar_feature(aa64_fp16, s)) {
             break;
         }
         /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_int_conv(DisasContext *s, uint32_t insn)
             break;
         case 0x6: /* 16-bit float, 32-bit int */
         case 0xe: /* 16-bit float, 64-bit int */
-            if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+            if (dc_isar_feature(aa64_fp16, s)) {
                 break;
             }
             /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_int_conv(DisasContext *s, uint32_t insn)
         case 1: /* float64 */
             break;
         case 3: /* float16 */
-            if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+            if (dc_isar_feature(aa64_fp16, s)) {
                 break;
             }
             /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_across_lanes(DisasContext *s, uint32_t insn)
          */
         is_min = extract32(size, 1, 1);
         is_fp = true;
-        if (!is_u && arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (!is_u && dc_isar_feature(aa64_fp16, s)) {
             size = 1;
         } else if (!is_u || !is_q || extract32(size, 0, 1)) {
             unallocated_encoding(s);
@@ -XXX,XX +XXX,XX @@ static void disas_simd_mod_imm(DisasContext *s, uint32_t insn)
 
     if (o2 != 0 || ((cmode == 0xf) && is_neg && !is_q)) {
         /* Check for FMOV (vector, immediate) - half-precision */
-        if (!(arm_dc_feature(s, ARM_FEATURE_V8_FP16) && o2 && cmode == 0xf)) {
+        if (!(dc_isar_feature(aa64_fp16, s) && o2 && cmode == 0xf)) {
             unallocated_encoding(s);
             return;
         }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_pairwise(DisasContext *s, uint32_t insn)
     case 0x2f: /* FMINP */
         /* FP op, size[0] is 32 or 64 bit*/
         if (!u) {
-            if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+            if (!dc_isar_feature(aa64_fp16, s)) {
                 unallocated_encoding(s);
                 return;
             } else {
@@ -XXX,XX +XXX,XX @@ static void handle_simd_shift_intfp_conv(DisasContext *s, bool is_scalar,
         size = MO_32;
     } else if (immh & 2) {
         size = MO_16;
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (!dc_isar_feature(aa64_fp16, s)) {
             unallocated_encoding(s);
             return;
         }
@@ -XXX,XX +XXX,XX @@ static void handle_simd_shift_fpint_conv(DisasContext *s, bool is_scalar,
         size = MO_32;
     } else if (immh & 0x2) {
         size = MO_16;
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (!dc_isar_feature(aa64_fp16, s)) {
             unallocated_encoding(s);
             return;
         }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_three_reg_same_fp16(DisasContext *s,
         return;
     }
 
-    if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+    if (!dc_isar_feature(aa64_fp16, s)) {
         unallocated_encoding(s);
     }
 
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_fp16(DisasContext *s, uint32_t insn)
     TCGv_ptr fpst;
     bool pairwise = false;
 
-    if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+    if (!dc_isar_feature(aa64_fp16, s)) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
     case 0x1c: /* FCADD, #90 */
     case 0x1e: /* FCADD, #270 */
         if (size == 0
-            || (size == 1 && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))
+            || (size == 1 && !dc_isar_feature(aa64_fp16, s))
             || (size == 3 && !is_q)) {
             unallocated_encoding(s);
             return;
@@ -XXX,XX +XXX,XX @@ static void disas_simd_two_reg_misc_fp16(DisasContext *s, uint32_t insn)
     bool need_fpst = true;
     int rmode;
 
-    if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+    if (!dc_isar_feature(aa64_fp16, s)) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
         }
         break;
     }
-    if (is_fp16 && !arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+    if (is_fp16 && !dc_isar_feature(aa64_fp16, s)) {
         unallocated_encoding(s);
         return;
     }
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
         int size = extract32(insn, 20, 1);
         data = extract32(insn, 23, 2); /* rot */
         if (!dc_isar_feature(aa32_vcma, s)
-            || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
+            || (!size && !dc_isar_feature(aa32_fp16_arith, s))) {
             return 1;
         }
         fn_gvec_ptr = size ? gen_helper_gvec_fcmlas : gen_helper_gvec_fcmlah;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
         int size = extract32(insn, 20, 1);
         data = extract32(insn, 24, 1); /* rot */
         if (!dc_isar_feature(aa32_vcma, s)
-            || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
+            || (!size && !dc_isar_feature(aa32_fp16_arith, s))) {
             return 1;
         }
         fn_gvec_ptr = size ? gen_helper_gvec_fcadds : gen_helper_gvec_fcaddh;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
             return 1;
         }
         if (size == 0) {
-            if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+            if (!dc_isar_feature(aa32_fp16_arith, s)) {
                 return 1;
             }
             /* For fp16, rm is just Vm, and index is M.  */
-- 
2.19.1

For AArch32, exception return happens through certain kinds
of CPSR write. We don't currently have any CPU_LOG_INT logging
of these events (unlike AArch64, where we log in the ERET
instruction). Add some suitable logging.

This will log exception returns like this:
Exception return from AArch32 hyp to usr PC 0x80100374

paralleling the existing logging in the exception_return
helper for AArch64 exception returns:
Exception return from AArch64 EL2 to AArch64 EL0 PC 0x8003045c
Exception return from AArch64 EL2 to AArch32 EL0 PC 0x8003045c

(Note that an AArch32 exception return can only be
AArch32->AArch32, never to AArch64.)

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-2-peter.maydell@linaro.org
---
 target/arm/internals.h | 18 ++++++++++++++++++
 target/arm/helper.c    | 10 ++++++++++
 target/arm/translate.c |  7 +------
 3 files changed, 29 insertions(+), 6 deletions(-)

diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ static inline uint32_t v7m_sp_limit(CPUARMState *env)
     }
 }
 
+/**
+ * aarch32_mode_name(): Return name of the AArch32 CPU mode
+ * @psr: Program Status Register indicating CPU mode
+ *
+ * Returns, for debug logging purposes, a printable representation
+ * of the AArch32 CPU mode ("svc", "usr", etc) as indicated by
+ * the low bits of the specified PSR.
+ */
+static inline const char *aarch32_mode_name(uint32_t psr)
+{
+    static const char cpu_mode_names[16][4] = {
+        "usr", "fiq", "irq", "svc", "???", "???", "mon", "abt",
+        "???", "???", "hyp", "und", "???", "???", "???", "sys"
+    };
+
+    return cpu_mode_names[psr & 0xf];
+}
+
 #endif
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void cpsr_write(CPUARMState *env, uint32_t val, uint32_t mask,
                 mask |= CPSR_IL;
                 val |= CPSR_IL;
             }
+            qemu_log_mask(LOG_GUEST_ERROR,
+                          "Illegal AArch32 mode switch attempt from %s to %s\n",
+                          aarch32_mode_name(env->uncached_cpsr),
+                          aarch32_mode_name(val));
         } else {
+            qemu_log_mask(CPU_LOG_INT, "%s %s to %s PC 0x%" PRIx32 "\n",
+                          write_type == CPSRWriteExceptionReturn ?
+                          "Exception return from AArch32" :
+                          "AArch32 mode switch from",
+                          aarch32_mode_name(env->uncached_cpsr),
+                          aarch32_mode_name(val), env->regs[15]);
             switch_mode(env, val & CPSR_M);
         }
     }
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ void gen_intermediate_code(CPUState *cpu, TranslationBlock *tb)
     translator_loop(ops, &dc.base, cpu, tb);
 }
 
-static const char *cpu_mode_names[16] = {
-  "usr", "fiq", "irq", "svc", "???", "???", "mon", "abt",
-  "???", "???", "hyp", "und", "???", "???", "???", "sys"
-};
-
 void arm_cpu_dump_state(CPUState *cs, FILE *f, fprintf_function cpu_fprintf,
                         int flags)
 {
@@ -XXX,XX +XXX,XX @@ void arm_cpu_dump_state(CPUState *cs, FILE *f, fprintf_function cpu_fprintf,
                     psr & CPSR_V ? 'V' : '-',
                     psr & CPSR_T ? 'T' : 'A',
                     ns_status,
-                    cpu_mode_names[psr & 0xf], (psr & 0x10) ? 32 : 26);
+                    aarch32_mode_name(psr), (psr & 0x10) ? 32 : 26);
     }
 
     if (flags & CPU_DUMP_FPU) {
-- 
2.19.1

The switch_mode() function is defined in target/arm/helper.c and used
only in that file and nowhere else, so we can make it file-local
rather than global.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-3-peter.maydell@linaro.org
---
 target/arm/internals.h | 1 -
 target/arm/helper.c    | 6 ++++--
 2 files changed, 4 insertions(+), 3 deletions(-)

diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ static inline int bank_number(int mode)
     g_assert_not_reached();
 }
 
-void switch_mode(CPUARMState *, int);
 void arm_cpu_register_gdb_regs_for_features(ARMCPU *cpu);
 void arm_translate_init(void);
 
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void v8m_security_lookup(CPUARMState *env, uint32_t address,
                                 V8M_SAttributes *sattrs);
 #endif
 
+static void switch_mode(CPUARMState *env, int mode);
+
 static int vfp_gdb_get_reg(CPUARMState *env, uint8_t *buf, int reg)
 {
     int nregs;
@@ -XXX,XX +XXX,XX @@ uint32_t HELPER(v7m_tt)(CPUARMState *env, uint32_t addr, uint32_t op)
     return 0;
 }
 
-void switch_mode(CPUARMState *env, int mode)
+static void switch_mode(CPUARMState *env, int mode)
 {
     ARMCPU *cpu = arm_env_get_cpu(env);
 
@@ -XXX,XX +XXX,XX @@ void aarch64_sync_64_to_32(CPUARMState *env)
 
 #else
 
-void switch_mode(CPUARMState *env, int mode)
+static void switch_mode(CPUARMState *env, int mode)
 {
     int old_mode;
     int i;
-- 
2.19.1

The HCR.FB virtualization configuration register bit requests that
TLB maintenance, branch predictor invalidate-all and icache
invalidate-all operations performed in NS EL1 should be upgraded
from "local CPU only to "broadcast within Inner Shareable domain".
For QEMU we NOP the branch predictor and icache operations, so
we only need to upgrade the TLB invalidates:
 AArch32 TLBIALL, TLBIMVA, TLBIASID, DTLBIALL, DTLBIMVA, DTLBIASID,
         ITLBIALL, ITLBIMVA, ITLBIASID, TLBIMVAA, TLBIMVAL, TLBIMVAAL
 AArch64 TLBI VMALLE1, TLBI VAE1, TLBI ASIDE1, TLBI VAAE1,
         TLBI VALE1, TLBI VAALE1

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-4-peter.maydell@linaro.org
---
 target/arm/helper.c | 191 +++++++++++++++++++++++++++-----------------
 1 file changed, 116 insertions(+), 75 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void contextidr_write(CPUARMState *env, const ARMCPRegInfo *ri,
     raw_write(env, ri, value);
 }
 
-static void tlbiall_write(CPUARMState *env, const ARMCPRegInfo *ri,
-                          uint64_t value)
-{
-    /* Invalidate all (TLBIALL) */
-    ARMCPU *cpu = arm_env_get_cpu(env);
-
-    tlb_flush(CPU(cpu));
-}
-
-static void tlbimva_write(CPUARMState *env, const ARMCPRegInfo *ri,
-                          uint64_t value)
-{
-    /* Invalidate single TLB entry by MVA and ASID (TLBIMVA) */
-    ARMCPU *cpu = arm_env_get_cpu(env);
-
-    tlb_flush_page(CPU(cpu), value & TARGET_PAGE_MASK);
-}
-
-static void tlbiasid_write(CPUARMState *env, const ARMCPRegInfo *ri,
-                           uint64_t value)
-{
-    /* Invalidate by ASID (TLBIASID) */
-    ARMCPU *cpu = arm_env_get_cpu(env);
-
-    tlb_flush(CPU(cpu));
-}
-
-static void tlbimvaa_write(CPUARMState *env, const ARMCPRegInfo *ri,
-                           uint64_t value)
-{
-    /* Invalidate single entry by MVA, all ASIDs (TLBIMVAA) */
-    ARMCPU *cpu = arm_env_get_cpu(env);
-
-    tlb_flush_page(CPU(cpu), value & TARGET_PAGE_MASK);
-}
-
 /* IS variants of TLB operations must affect all cores */
 static void tlbiall_is_write(CPUARMState *env, const ARMCPRegInfo *ri,
                              uint64_t value)
@@ -XXX,XX +XXX,XX @@ static void tlbimvaa_is_write(CPUARMState *env, const ARMCPRegInfo *ri,
     tlb_flush_page_all_cpus_synced(cs, value & TARGET_PAGE_MASK);
 }
 
+/*
+ * Non-IS variants of TLB operations are upgraded to
+ * IS versions if we are at NS EL1 and HCR_EL2.FB is set to
+ * force broadcast of these operations.
+ */
+static bool tlb_force_broadcast(CPUARMState *env)
+{
+    return (env->cp15.hcr_el2 & HCR_FB) &&
+        arm_current_el(env) == 1 && arm_is_secure_below_el3(env);
+}
+
+static void tlbiall_write(CPUARMState *env, const ARMCPRegInfo *ri,
+                          uint64_t value)
+{
+    /* Invalidate all (TLBIALL) */
+    ARMCPU *cpu = arm_env_get_cpu(env);
+
+    if (tlb_force_broadcast(env)) {
+        tlbiall_is_write(env, NULL, value);
+        return;
+    }
+
+    tlb_flush(CPU(cpu));
+}
+
+static void tlbimva_write(CPUARMState *env, const ARMCPRegInfo *ri,
+                          uint64_t value)
+{
+    /* Invalidate single TLB entry by MVA and ASID (TLBIMVA) */
+    ARMCPU *cpu = arm_env_get_cpu(env);
+
+    if (tlb_force_broadcast(env)) {
+        tlbimva_is_write(env, NULL, value);
+        return;
+    }
+
+    tlb_flush_page(CPU(cpu), value & TARGET_PAGE_MASK);
+}
+
+static void tlbiasid_write(CPUARMState *env, const ARMCPRegInfo *ri,
+                           uint64_t value)
+{
+    /* Invalidate by ASID (TLBIASID) */
+    ARMCPU *cpu = arm_env_get_cpu(env);
+
+    if (tlb_force_broadcast(env)) {
+        tlbiasid_is_write(env, NULL, value);
+        return;
+    }
+
+    tlb_flush(CPU(cpu));
+}
+
+static void tlbimvaa_write(CPUARMState *env, const ARMCPRegInfo *ri,
+                           uint64_t value)
+{
+    /* Invalidate single entry by MVA, all ASIDs (TLBIMVAA) */
+    ARMCPU *cpu = arm_env_get_cpu(env);
+
+    if (tlb_force_broadcast(env)) {
+        tlbimvaa_is_write(env, NULL, value);
+        return;
+    }
+
+    tlb_flush_page(CPU(cpu), value & TARGET_PAGE_MASK);
+}
+
 static void tlbiall_nsnh_write(CPUARMState *env, const ARMCPRegInfo *ri,
                                uint64_t value)
 {
@@ -XXX,XX +XXX,XX @@ static CPAccessResult aa64_cacheop_access(CPUARMState *env,
  * Page D4-1736 (DDI0487A.b)
  */
 
-static void tlbi_aa64_vmalle1_write(CPUARMState *env, const ARMCPRegInfo *ri,
-                                    uint64_t value)
-{
-    CPUState *cs = ENV_GET_CPU(env);
-
-    if (arm_is_secure_below_el3(env)) {
-        tlb_flush_by_mmuidx(cs,
-                            ARMMMUIdxBit_S1SE1 |
-                            ARMMMUIdxBit_S1SE0);
-    } else {
-        tlb_flush_by_mmuidx(cs,
-                            ARMMMUIdxBit_S12NSE1 |
-                            ARMMMUIdxBit_S12NSE0);
-    }
-}
-
 static void tlbi_aa64_vmalle1is_write(CPUARMState *env, const ARMCPRegInfo *ri,
                                       uint64_t value)
 {
@@ -XXX,XX +XXX,XX @@ static void tlbi_aa64_vmalle1is_write(CPUARMState *env, const ARMCPRegInfo *ri,
     }
 }
 
+static void tlbi_aa64_vmalle1_write(CPUARMState *env, const ARMCPRegInfo *ri,
+                                    uint64_t value)
+{
+    CPUState *cs = ENV_GET_CPU(env);
+
+    if (tlb_force_broadcast(env)) {
+        tlbi_aa64_vmalle1_write(env, NULL, value);
+        return;
+    }
+
+    if (arm_is_secure_below_el3(env)) {
+        tlb_flush_by_mmuidx(cs,
+                            ARMMMUIdxBit_S1SE1 |
+                            ARMMMUIdxBit_S1SE0);
+    } else {
+        tlb_flush_by_mmuidx(cs,
+                            ARMMMUIdxBit_S12NSE1 |
+                            ARMMMUIdxBit_S12NSE0);
+    }
+}
+
 static void tlbi_aa64_alle1_write(CPUARMState *env, const ARMCPRegInfo *ri,
                                   uint64_t value)
 {
@@ -XXX,XX +XXX,XX @@ static void tlbi_aa64_alle3is_write(CPUARMState *env, const ARMCPRegInfo *ri,
     tlb_flush_by_mmuidx_all_cpus_synced(cs, ARMMMUIdxBit_S1E3);
 }
 
-static void tlbi_aa64_vae1_write(CPUARMState *env, const ARMCPRegInfo *ri,
-                                 uint64_t value)
-{
-    /* Invalidate by VA, EL1&0 (AArch64 version).
-     * Currently handles all of VAE1, VAAE1, VAALE1 and VALE1,
-     * since we don't support flush-for-specific-ASID-only or
-     * flush-last-level-only.
-     */
-    ARMCPU *cpu = arm_env_get_cpu(env);
-    CPUState *cs = CPU(cpu);
-    uint64_t pageaddr = sextract64(value << 12, 0, 56);
-
-    if (arm_is_secure_below_el3(env)) {
-        tlb_flush_page_by_mmuidx(cs, pageaddr,
-                                 ARMMMUIdxBit_S1SE1 |
-                                 ARMMMUIdxBit_S1SE0);
-    } else {
-        tlb_flush_page_by_mmuidx(cs, pageaddr,
-                                 ARMMMUIdxBit_S12NSE1 |
-                                 ARMMMUIdxBit_S12NSE0);
-    }
-}
-
 static void tlbi_aa64_vae2_write(CPUARMState *env, const ARMCPRegInfo *ri,
                                  uint64_t value)
 {
@@ -XXX,XX +XXX,XX @@ static void tlbi_aa64_vae1is_write(CPUARMState *env, const ARMCPRegInfo *ri,
     }
 }
 
+static void tlbi_aa64_vae1_write(CPUARMState *env, const ARMCPRegInfo *ri,
+                                 uint64_t value)
+{
+    /* Invalidate by VA, EL1&0 (AArch64 version).
+     * Currently handles all of VAE1, VAAE1, VAALE1 and VALE1,
+     * since we don't support flush-for-specific-ASID-only or
+     * flush-last-level-only.
+     */
+    ARMCPU *cpu = arm_env_get_cpu(env);
+    CPUState *cs = CPU(cpu);
+    uint64_t pageaddr = sextract64(value << 12, 0, 56);
+
+    if (tlb_force_broadcast(env)) {
+        tlbi_aa64_vae1is_write(env, NULL, value);
+        return;
+    }
+
+    if (arm_is_secure_below_el3(env)) {
+        tlb_flush_page_by_mmuidx(cs, pageaddr,
+                                 ARMMMUIdxBit_S1SE1 |
+                                 ARMMMUIdxBit_S1SE0);
+    } else {
+        tlb_flush_page_by_mmuidx(cs, pageaddr,
+                                 ARMMMUIdxBit_S12NSE1 |
+                                 ARMMMUIdxBit_S12NSE0);
+    }
+}
+
 static void tlbi_aa64_vae2is_write(CPUARMState *env, const ARMCPRegInfo *ri,
                                    uint64_t value)
 {
-- 
2.19.1

The HCR.DC virtualization configuration register bit has the
following effects:
 * SCTLR.M behaves as if it is 0 for all purposes except
   direct reads of the bit
 * HCR.VM behaves as if it is 1 for all purposes except
   direct reads of the bit
 * the memory type produced by the first stage of the EL1&EL0
   translation regime is Normal Non-Shareable,
   Inner Write-Back Read-Allocate Write-Allocate,
   Outer Write-Back Read-Allocate Write-Allocate.

Implement this behaviour.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-5-peter.maydell@linaro.org
---
 target/arm/helper.c | 23 +++++++++++++++++++++--
 1 file changed, 21 insertions(+), 2 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static uint64_t do_ats_write(CPUARMState *env, uint64_t value,
          * * The Non-secure TTBCR.EAE bit is set to 1
          * * The implementation includes EL2, and the value of HCR.VM is 1
          *
+         * (Note that HCR.DC makes HCR.VM behave as if it is 1.)
+         *
          * ATS1Hx always uses the 64bit format (not supported yet).
          */
         format64 = arm_s1_regime_using_lpae_format(env, mmu_idx);
 
         if (arm_feature(env, ARM_FEATURE_EL2)) {
             if (mmu_idx == ARMMMUIdx_S12NSE0 || mmu_idx == ARMMMUIdx_S12NSE1) {
-                format64 |= env->cp15.hcr_el2 & HCR_VM;
+                format64 |= env->cp15.hcr_el2 & (HCR_VM | HCR_DC);
             } else {
                 format64 |= arm_current_el(env) == 2;
             }
@@ -XXX,XX +XXX,XX @@ static inline bool regime_translation_disabled(CPUARMState *env,
     }
 
     if (mmu_idx == ARMMMUIdx_S2NS) {
-        return (env->cp15.hcr_el2 & HCR_VM) == 0;
+        /* HCR.DC means HCR.VM behaves as 1 */
+        return (env->cp15.hcr_el2 & (HCR_DC | HCR_VM)) == 0;
     }
 
     if (env->cp15.hcr_el2 & HCR_TGE) {
@@ -XXX,XX +XXX,XX @@ static inline bool regime_translation_disabled(CPUARMState *env,
         }
     }
 
+    if ((env->cp15.hcr_el2 & HCR_DC) &&
+        (mmu_idx == ARMMMUIdx_S1NSE0 || mmu_idx == ARMMMUIdx_S1NSE1)) {
+        /* HCR.DC means SCTLR_EL1.M behaves as 0 */
+        return true;
+    }
+
     return (regime_sctlr(env, mmu_idx) & SCTLR_M) == 0;
 }
 
@@ -XXX,XX +XXX,XX @@ static bool get_phys_addr(CPUARMState *env, target_ulong address,
 
             /* Combine the S1 and S2 cache attributes, if needed */
             if (!ret && cacheattrs != NULL) {
+                if (env->cp15.hcr_el2 & HCR_DC) {
+                    /*
+                     * HCR.DC forces the first stage attributes to
+                     *  Normal Non-Shareable,
+                     *  Inner Write-Back Read-Allocate Write-Allocate,
+                     *  Outer Write-Back Read-Allocate Write-Allocate.
+                     */
+                    cacheattrs->attrs = 0xff;
+                    cacheattrs->shareability = 0;
+                }
                 *cacheattrs = combine_cacheattrs(*cacheattrs, cacheattrs2);
             }
 
-- 
2.19.1

The A/I/F bits in ISR_EL1 should track the virtual interrupt
status, not the physical interrupt status, if the associated
HCR_EL2.AMO/IMO/FMO bit is set. Implement this, rather than
always showing the physical interrupt status.

We don't currently implement anything to do with external
aborts, so this applies only to the I and F bits (though it
ought to be possible for the outer guest to present a virtual
external abort to the inner guest, even if QEMU doesn't
emulate physical external aborts, so there is missing
functionality in this area).

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-6-peter.maydell@linaro.org
---
 target/arm/helper.c | 22 ++++++++++++++++++----
 1 file changed, 18 insertions(+), 4 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static uint64_t isr_read(CPUARMState *env, const ARMCPRegInfo *ri)
     CPUState *cs = ENV_GET_CPU(env);
     uint64_t ret = 0;
 
-    if (cs->interrupt_request & CPU_INTERRUPT_HARD) {
-        ret |= CPSR_I;
+    if (arm_hcr_el2_imo(env)) {
+        if (cs->interrupt_request & CPU_INTERRUPT_VIRQ) {
+            ret |= CPSR_I;
+        }
+    } else {
+        if (cs->interrupt_request & CPU_INTERRUPT_HARD) {
+            ret |= CPSR_I;
+        }
     }
-    if (cs->interrupt_request & CPU_INTERRUPT_FIQ) {
-        ret |= CPSR_F;
+
+    if (arm_hcr_el2_fmo(env)) {
+        if (cs->interrupt_request & CPU_INTERRUPT_VFIQ) {
+            ret |= CPSR_F;
+        }
+    } else {
+        if (cs->interrupt_request & CPU_INTERRUPT_FIQ) {
+            ret |= CPSR_F;
+        }
     }
+
     /* External aborts are not possible in QEMU so A bit is always clear */
     return ret;
 }
-- 
2.19.1

The HCR_EL2 VI and VF bits are supposed to track whether there is
a pending virtual IRQ or virtual FIQ. For QEMU we store the
pending VIRQ/VFIQ status in cs->interrupt_request, so this means:
 * if the register is read we must get these bit values from
   cs->interrupt_request
 * if the register is written then we must write the bit
   values back into cs->interrupt_request

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-7-peter.maydell@linaro.org
---
 target/arm/helper.c | 47 +++++++++++++++++++++++++++++++++++++++++----
 1 file changed, 43 insertions(+), 4 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo el3_no_el2_v8_cp_reginfo[] = {
 static void hcr_write(CPUARMState *env, const ARMCPRegInfo *ri, uint64_t value)
 {
     ARMCPU *cpu = arm_env_get_cpu(env);
+    CPUState *cs = ENV_GET_CPU(env);
     uint64_t valid_mask = HCR_MASK;
 
     if (arm_feature(env, ARM_FEATURE_EL3)) {
@@ -XXX,XX +XXX,XX @@ static void hcr_write(CPUARMState *env, const ARMCPRegInfo *ri, uint64_t value)
     /* Clear RES0 bits.  */
     value &= valid_mask;
 
+    /*
+     * VI and VF are kept in cs->interrupt_request. Modifying that
+     * requires that we have the iothread lock, which is done by
+     * marking the reginfo structs as ARM_CP_IO.
+     * Note that if a write to HCR pends a VIRQ or VFIQ it is never
+     * possible for it to be taken immediately, because VIRQ and
+     * VFIQ are masked unless running at EL0 or EL1, and HCR
+     * can only be written at EL2.
+     */
+    g_assert(qemu_mutex_iothread_locked());
+    if (value & HCR_VI) {
+        cs->interrupt_request |= CPU_INTERRUPT_VIRQ;
+    } else {
+        cs->interrupt_request &= ~CPU_INTERRUPT_VIRQ;
+    }
+    if (value & HCR_VF) {
+        cs->interrupt_request |= CPU_INTERRUPT_VFIQ;
+    } else {
+        cs->interrupt_request &= ~CPU_INTERRUPT_VFIQ;
+    }
+    value &= ~(HCR_VI | HCR_VF);
+
     /* These bits change the MMU setup:
      * HCR_VM enables stage 2 translation
      * HCR_PTW forbids certain page-table setups
@@ -XXX,XX +XXX,XX @@ static void hcr_writelow(CPUARMState *env, const ARMCPRegInfo *ri,
     hcr_write(env, NULL, value);
 }
 
+static uint64_t hcr_read(CPUARMState *env, const ARMCPRegInfo *ri)
+{
+    /* The VI and VF bits live in cs->interrupt_request */
+    uint64_t ret = env->cp15.hcr_el2 & ~(HCR_VI | HCR_VF);
+    CPUState *cs = ENV_GET_CPU(env);
+
+    if (cs->interrupt_request & CPU_INTERRUPT_VIRQ) {
+        ret |= HCR_VI;
+    }
+    if (cs->interrupt_request & CPU_INTERRUPT_VFIQ) {
+        ret |= HCR_VF;
+    }
+    return ret;
+}
+
 static const ARMCPRegInfo el2_cp_reginfo[] = {
     { .name = "HCR_EL2", .state = ARM_CP_STATE_AA64,
+      .type = ARM_CP_IO,
       .opc0 = 3, .opc1 = 4, .crn = 1, .crm = 1, .opc2 = 0,
       .access = PL2_RW, .fieldoffset = offsetof(CPUARMState, cp15.hcr_el2),
-      .writefn = hcr_write },
+      .writefn = hcr_write, .readfn = hcr_read },
     { .name = "HCR", .state = ARM_CP_STATE_AA32,
-      .type = ARM_CP_ALIAS,
+      .type = ARM_CP_ALIAS | ARM_CP_IO,
       .cp = 15, .opc1 = 4, .crn = 1, .crm = 1, .opc2 = 0,
       .access = PL2_RW, .fieldoffset = offsetof(CPUARMState, cp15.hcr_el2),
-      .writefn = hcr_writelow },
+      .writefn = hcr_writelow, .readfn = hcr_read },
     { .name = "ELR_EL2", .state = ARM_CP_STATE_AA64,
       .type = ARM_CP_ALIAS,
       .opc0 = 3, .opc1 = 4, .crn = 4, .crm = 0, .opc2 = 1,
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo el2_cp_reginfo[] = {
 
 static const ARMCPRegInfo el2_v8_cp_reginfo[] = {
     { .name = "HCR2", .state = ARM_CP_STATE_AA32,
-      .type = ARM_CP_ALIAS,
+      .type = ARM_CP_ALIAS | ARM_CP_IO,
       .cp = 15, .opc1 = 4, .crn = 1, .crm = 1, .opc2 = 4,
       .access = PL2_RW,
       .fieldoffset = offsetofhigh32(CPUARMState, cp15.hcr_el2),
-- 
2.19.1

If the HCR_EL2 PTW virtualizaiton configuration register bit
is set, then this means that a stage 2 Permission fault must
be generated if a stage 1 translation table access is made
to an address that is mapped as Device memory in stage 2.
Implement this.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-8-peter.maydell@linaro.org
---
 target/arm/helper.c | 21 ++++++++++++++++++++-
 1 file changed, 20 insertions(+), 1 deletion(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static hwaddr S1_ptw_translate(CPUARMState *env, ARMMMUIdx mmu_idx,
         hwaddr s2pa;
         int s2prot;
         int ret;
+        ARMCacheAttrs cacheattrs = {};
+        ARMCacheAttrs *pcacheattrs = NULL;
+
+        if (env->cp15.hcr_el2 & HCR_PTW) {
+            /*
+             * PTW means we must fault if this S1 walk touches S2 Device
+             * memory; otherwise we don't care about the attributes and can
+             * save the S2 translation the effort of computing them.
+             */
+            pcacheattrs = &cacheattrs;
+        }
 
         ret = get_phys_addr_lpae(env, addr, 0, ARMMMUIdx_S2NS, &s2pa,
-                                 &txattrs, &s2prot, &s2size, fi, NULL);
+                                 &txattrs, &s2prot, &s2size, fi, pcacheattrs);
         if (ret) {
             assert(fi->type != ARMFault_None);
             fi->s2addr = addr;
@@ -XXX,XX +XXX,XX @@ static hwaddr S1_ptw_translate(CPUARMState *env, ARMMMUIdx mmu_idx,
             fi->s1ptw = true;
             return ~0;
         }
+        if (pcacheattrs && (pcacheattrs->attrs & 0xf0) == 0) {
+            /* Access was to Device memory: generate Permission fault */
+            fi->type = ARMFault_Permission;
+            fi->s2addr = addr;
+            fi->stage2 = true;
+            fi->s1ptw = true;
+            return ~0;
+        }
         addr = s2pa;
     }
     return addr;
-- 
2.19.1

Create and use a utility function to extract the EC field
from a syndrome, rather than open-coding the shift.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-9-peter.maydell@linaro.org
---
 target/arm/internals.h | 5 +++++
 target/arm/helper.c    | 4 ++--
 target/arm/kvm64.c     | 2 +-
 target/arm/op_helper.c | 2 +-
 4 files changed, 9 insertions(+), 4 deletions(-)

diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ enum arm_exception_class {
 #define ARM_EL_IL (1 << ARM_EL_IL_SHIFT)
 #define ARM_EL_ISV (1 << ARM_EL_ISV_SHIFT)
 
+static inline uint32_t syn_get_ec(uint32_t syn)
+{
+    return syn >> ARM_EL_EC_SHIFT;
+}
+
 /* Utility functions for constructing various kinds of syndrome value.
  * Note that in general we follow the AArch64 syndrome values; in a
  * few cases the value in HSR for exceptions taken to AArch32 Hyp
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_do_interrupt_aarch32(CPUState *cs)
     uint32_t moe;
 
     /* If this is a debug exception we must update the DBGDSCR.MOE bits */
-    switch (env->exception.syndrome >> ARM_EL_EC_SHIFT) {
+    switch (syn_get_ec(env->exception.syndrome)) {
     case EC_BREAKPOINT:
     case EC_BREAKPOINT_SAME_EL:
         moe = 1;
@@ -XXX,XX +XXX,XX @@ void arm_cpu_do_interrupt(CPUState *cs)
     if (qemu_loglevel_mask(CPU_LOG_INT)
         && !excp_is_internal(cs->exception_index)) {
         qemu_log_mask(CPU_LOG_INT, "...with ESR 0x%x/0x%" PRIx32 "\n",
-                      env->exception.syndrome >> ARM_EL_EC_SHIFT,
+                      syn_get_ec(env->exception.syndrome),
                       env->exception.syndrome);
     }
 
diff --git a/target/arm/kvm64.c b/target/arm/kvm64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/kvm64.c
+++ b/target/arm/kvm64.c
@@ -XXX,XX +XXX,XX @@ int kvm_arch_remove_sw_breakpoint(CPUState *cs, struct kvm_sw_breakpoint *bp)
 
 bool kvm_arm_handle_debug(CPUState *cs, struct kvm_debug_exit_arch *debug_exit)
 {
-    int hsr_ec = debug_exit->hsr >> ARM_EL_EC_SHIFT;
+    int hsr_ec = syn_get_ec(debug_exit->hsr);
     ARMCPU *cpu = ARM_CPU(cs);
     CPUClass *cc = CPU_GET_CLASS(cs);
     CPUARMState *env = &cpu->env;
diff --git a/target/arm/op_helper.c b/target/arm/op_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/op_helper.c
+++ b/target/arm/op_helper.c
@@ -XXX,XX +XXX,XX @@ void raise_exception(CPUARMState *env, uint32_t excp,
          * (see DDI0478C.a D1.10.4)
          */
         target_el = 2;
-        if (syndrome >> ARM_EL_EC_SHIFT == EC_ADVSIMDFPACCESSTRAP) {
+        if (syn_get_ec(syndrome) == EC_ADVSIMDFPACCESSTRAP) {
             syndrome = syn_uncategorized();
         }
     }
-- 
2.19.1

For the v7 version of the Arm architecture, the IL bit in
syndrome register values where the field is not valid was
defined to be UNK/SBZP. In v8 this is RES1, which is what
QEMU currently implements. Handle the desired v7 behaviour
by squashing the IL bit for the affected cases:
 * EC == EC_UNCATEGORIZED
 * prefetch aborts
 * data aborts where ISV is 0

(The fourth case listed in the v8 Arm ARM DDI 0487C.a in
section G7.2.70, "illegal state exception", can't happen
on a v7 CPU.)

This deals with a corner case noted in a comment.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-10-peter.maydell@linaro.org
---
 target/arm/internals.h |  7 ++-----
 target/arm/helper.c    | 13 +++++++++++++
 2 files changed, 15 insertions(+), 5 deletions(-)

diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ static inline uint32_t syn_get_ec(uint32_t syn)
 /* Utility functions for constructing various kinds of syndrome value.
  * Note that in general we follow the AArch64 syndrome values; in a
  * few cases the value in HSR for exceptions taken to AArch32 Hyp
- * mode differs slightly, so if we ever implemented Hyp mode then the
- * syndrome value would need some massaging on exception entry.
- * (One example of this is that AArch64 defaults to IL bit set for
- * exceptions which don't specifically indicate information about the
- * trapping instruction, whereas AArch32 defaults to IL bit clear.)
+ * mode differs slightly, and we fix this up when populating HSR in
+ * arm_cpu_do_interrupt_aarch32_hyp().
  */
 static inline uint32_t syn_uncategorized(void)
 {
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_do_interrupt_aarch32_hyp(CPUState *cs)
     }
 
     if (cs->exception_index != EXCP_IRQ && cs->exception_index != EXCP_FIQ) {
+        if (!arm_feature(env, ARM_FEATURE_V8)) {
+            /*
+             * QEMU syndrome values are v8-style. v7 has the IL bit
+             * UNK/SBZP for "field not valid" cases, where v8 uses RES1.
+             * If this is a v7 CPU, squash the IL bit in those cases.
+             */
+            if (cs->exception_index == EXCP_PREFETCH_ABORT ||
+                (cs->exception_index == EXCP_DATA_ABORT &&
+                 !(env->exception.syndrome & ARM_EL_ISV)) ||
+                syn_get_ec(env->exception.syndrome) == EC_UNCATEGORIZED) {
+                env->exception.syndrome &= ~ARM_EL_IL;
+            }
+        }
         env->cp15.esr_el[2] = env->exception.syndrome;
     }
 
-- 
2.19.1

For traps of FP/SIMD instructions to AArch32 Hyp mode, the syndrome
provided in HSR has more information than is reported to AArch64.
Specifically, there are extra fields TA and coproc which indicate
whether the trapped instruction was FP or SIMD. Add this extra
information to the syndromes we construct, and mask it out when
taking the exception to AArch64.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-11-peter.maydell@linaro.org
---
 target/arm/internals.h | 14 +++++++++++++-
 target/arm/helper.c    |  9 +++++++++
 target/arm/translate.c |  8 ++++----
 3 files changed, 26 insertions(+), 5 deletions(-)

diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ static inline uint32_t syn_get_ec(uint32_t syn)
  * few cases the value in HSR for exceptions taken to AArch32 Hyp
  * mode differs slightly, and we fix this up when populating HSR in
  * arm_cpu_do_interrupt_aarch32_hyp().
+ * The exception is FP/SIMD access traps -- these report extra information
+ * when taking an exception to AArch32. For those we include the extra coproc
+ * and TA fields, and mask them out when taking the exception to AArch64.
  */
 static inline uint32_t syn_uncategorized(void)
 {
@@ -XXX,XX +XXX,XX @@ static inline uint32_t syn_cp15_rrt_trap(int cv, int cond, int opc1, int crm,
 
 static inline uint32_t syn_fp_access_trap(int cv, int cond, bool is_16bit)
 {
+    /* AArch32 FP trap or any AArch64 FP/SIMD trap: TA == 0 coproc == 0xa */
     return (EC_ADVSIMDFPACCESSTRAP << ARM_EL_EC_SHIFT)
         | (is_16bit ? 0 : ARM_EL_IL)
-        | (cv << 24) | (cond << 20);
+        | (cv << 24) | (cond << 20) | 0xa;
+}
+
+static inline uint32_t syn_simd_access_trap(int cv, int cond, bool is_16bit)
+{
+    /* AArch32 SIMD trap: TA == 1 coproc == 0 */
+    return (EC_ADVSIMDFPACCESSTRAP << ARM_EL_EC_SHIFT)
+        | (is_16bit ? 0 : ARM_EL_IL)
+        | (cv << 24) | (cond << 20) | (1 << 5);
 }
 
 static inline uint32_t syn_sve_access_trap(void)
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_do_interrupt_aarch64(CPUState *cs)
     case EXCP_HVC:
     case EXCP_HYP_TRAP:
     case EXCP_SMC:
+        if (syn_get_ec(env->exception.syndrome) == EC_ADVSIMDFPACCESSTRAP) {
+            /*
+             * QEMU internal FP/SIMD syndromes from AArch32 include the
+             * TA and coproc fields which are only exposed if the exception
+             * is taken to AArch32 Hyp mode. Mask them out to get a valid
+             * AArch64 format syndrome.
+             */
+            env->exception.syndrome &= ~MAKE_64BIT_MASK(0, 20);
+        }
         env->cp15.esr_el[new_el] = env->exception.syndrome;
         break;
     case EXCP_IRQ:
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
      */
     if (s->fp_excp_el) {
         gen_exception_insn(s, 4, EXCP_UDEF,
-                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
+                           syn_simd_access_trap(1, 0xe, false), s->fp_excp_el);
         return 0;
     }
 
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
      */
     if (s->fp_excp_el) {
         gen_exception_insn(s, 4, EXCP_UDEF,
-                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
+                           syn_simd_access_trap(1, 0xe, false), s->fp_excp_el);
         return 0;
     }
 
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
 
     if (s->fp_excp_el) {
         gen_exception_insn(s, 4, EXCP_UDEF,
-                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
+                           syn_simd_access_trap(1, 0xe, false), s->fp_excp_el);
         return 0;
     }
     if (!s->vfp_enabled) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
 
     if (s->fp_excp_el) {
         gen_exception_insn(s, 4, EXCP_UDEF,
-                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
+                           syn_simd_access_trap(1, 0xe, false), s->fp_excp_el);
         return 0;
     }
     if (!s->vfp_enabled) {
-- 
2.19.1

From: Stewart Hildebrand <Stewart.Hildebrand@dornerworks.com>

"The Image must be placed text_offset bytes from a 2MB aligned base
address anywhere in usable system RAM and called there."

For the virt board, we write our startup bootloader at the very
bottom of RAM, so that bit can't be used for the image. To avoid
overlap in case the image requests to be loaded at an offset
smaller than our bootloader, we increment the load offset to the
next 2MB.

This fixes a boot failure for Xen AArch64.

Signed-off-by: Stewart Hildebrand <stewart.hildebrand@dornerworks.com>
Tested-by: Andre Przywara <andre.przywara@arm.com>
Message-id: b8a89518794b4436af0c151ed10de4fa@dornerworks.com
[PMM: Rephrased a comment a bit]
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/arm/boot.c | 18 ++++++++++++++++++
 1 file changed, 18 insertions(+)

diff --git a/hw/arm/boot.c b/hw/arm/boot.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/boot.c
+++ b/hw/arm/boot.c
@@ -XXX,XX +XXX,XX @@
 #include "qemu/config-file.h"
 #include "qemu/option.h"
 #include "exec/address-spaces.h"
+#include "qemu/units.h"
 
 /* Kernel boot protocol is specified in the kernel docs
  * Documentation/arm/Booting and Documentation/arm64/booting.txt
@@ -XXX,XX +XXX,XX @@
 #define ARM64_TEXT_OFFSET_OFFSET    8
 #define ARM64_MAGIC_OFFSET          56
 
+#define BOOTLOADER_MAX_SIZE         (4 * KiB)
+
 AddressSpace *arm_boot_address_space(ARMCPU *cpu,
                                      const struct arm_boot_info *info)
 {
@@ -XXX,XX +XXX,XX @@ static void write_bootloader(const char *name, hwaddr addr,
         code[i] = tswap32(insn);
     }
 
+    assert((len * sizeof(uint32_t)) < BOOTLOADER_MAX_SIZE);
+
     rom_add_blob_fixed_as(name, code, len * sizeof(uint32_t), addr, as);
 
     g_free(code);
@@ -XXX,XX +XXX,XX @@ static uint64_t load_aarch64_image(const char *filename, hwaddr mem_base,
         memcpy(&hdrvals, buffer + ARM64_TEXT_OFFSET_OFFSET, sizeof(hdrvals));
         if (hdrvals[1] != 0) {
             kernel_load_offset = le64_to_cpu(hdrvals[0]);
+
+            /*
+             * We write our startup "bootloader" at the very bottom of RAM,
+             * so that bit can't be used for the image. Luckily the Image
+             * format specification is that the image requests only an offset
+             * from a 2MB boundary, not an absolute load address. So if the
+             * image requests an offset that might mean it overlaps with the
+             * bootloader, we can just load it starting at 2MB+offset rather
+             * than 0MB + offset.
+             */
+            if (kernel_load_offset < BOOTLOADER_MAX_SIZE) {
+                kernel_load_offset += 2 * MiB;
+            }
         }
     }
 
-- 
2.19.1

From: Richard Henderson <rth@twiddle.net>

This can reduce the number of opcodes required for certain
complex forms of load-multiple (e.g. ld4.16b).

Signed-off-by: Richard Henderson <rth@twiddle.net>
Message-id: 20181011205206.3552-2-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 12 ++++++++----
 1 file changed, 8 insertions(+), 4 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
     bool is_store = !extract32(insn, 22, 1);
     bool is_postidx = extract32(insn, 23, 1);
     bool is_q = extract32(insn, 30, 1);
-    TCGv_i64 tcg_addr, tcg_rn;
+    TCGv_i64 tcg_addr, tcg_rn, tcg_ebytes;
 
     int ebytes = 1 << size;
     int elements = (is_q ? 128 : 64) / (8 << size);
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
     tcg_rn = cpu_reg_sp(s, rn);
     tcg_addr = tcg_temp_new_i64();
     tcg_gen_mov_i64(tcg_addr, tcg_rn);
+    tcg_ebytes = tcg_const_i64(ebytes);
 
     for (r = 0; r < rpt; r++) {
         int e;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
                         clear_vec_high(s, is_q, tt);
                     }
                 }
-                tcg_gen_addi_i64(tcg_addr, tcg_addr, ebytes);
+                tcg_gen_add_i64(tcg_addr, tcg_addr, tcg_ebytes);
                 tt = (tt + 1) % 32;
             }
         }
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
             tcg_gen_add_i64(tcg_rn, tcg_rn, cpu_reg(s, rm));
         }
     }
+    tcg_temp_free_i64(tcg_ebytes);
     tcg_temp_free_i64(tcg_addr);
 }
 
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
     bool replicate = false;
     int index = is_q << 3 | S << 2 | size;
     int ebytes, xs;
-    TCGv_i64 tcg_addr, tcg_rn;
+    TCGv_i64 tcg_addr, tcg_rn, tcg_ebytes;
 
     switch (scale) {
     case 3:
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
     tcg_rn = cpu_reg_sp(s, rn);
     tcg_addr = tcg_temp_new_i64();
     tcg_gen_mov_i64(tcg_addr, tcg_rn);
+    tcg_ebytes = tcg_const_i64(ebytes);
 
     for (xs = 0; xs < selem; xs++) {
         if (replicate) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
                 do_vec_st(s, rt, index, tcg_addr, scale);
             }
         }
-        tcg_gen_addi_i64(tcg_addr, tcg_addr, ebytes);
+        tcg_gen_add_i64(tcg_addr, tcg_addr, tcg_ebytes);
         rt = (rt + 1) % 32;
     }
 
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
             tcg_gen_add_i64(tcg_rn, tcg_rn, cpu_reg(s, rm));
         }
     }
+    tcg_temp_free_i64(tcg_ebytes);
     tcg_temp_free_i64(tcg_addr);
 }
 
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

This is done generically in translator_loop.

Reported-by: Laurent Desnogues <laurent.desnogues@gmail.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Message-id: 20181011205206.3552-3-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 1 -
 target/arm/translate.c     | 1 -
 2 files changed, 2 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_init_disas_context(DisasContextBase *dcbase,
 
 static void aarch64_tr_tb_start(DisasContextBase *db, CPUState *cpu)
 {
-    tcg_clear_temp_count();
 }
 
 static void aarch64_tr_insn_start(DisasContextBase *dcbase, CPUState *cpu)
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void arm_tr_tb_start(DisasContextBase *dcbase, CPUState *cpu)
         tcg_gen_movi_i32(tmp, 0);
         store_cpu_field(tmp, condexec_bits);
     }
-    tcg_clear_temp_count();
 }
 
 static void arm_tr_insn_start(DisasContextBase *dcbase, CPUState *cpu)
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-4-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 28 +++-------------------------
 1 file changed, 3 insertions(+), 25 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
     for (xs = 0; xs < selem; xs++) {
         if (replicate) {
             /* Load and replicate to all elements */
-            uint64_t mulconst;
             TCGv_i64 tcg_tmp = tcg_temp_new_i64();
 
             tcg_gen_qemu_ld_i64(tcg_tmp, tcg_addr,
                                 get_mem_index(s), s->be_data + scale);
-            switch (scale) {
-            case 0:
-                mulconst = 0x0101010101010101ULL;
-                break;
-            case 1:
-                mulconst = 0x0001000100010001ULL;
-                break;
-            case 2:
-                mulconst = 0x0000000100000001ULL;
-                break;
-            case 3:
-                mulconst = 0;
-                break;
-            default:
-                g_assert_not_reached();
-            }
-            if (mulconst) {
-                tcg_gen_muli_i64(tcg_tmp, tcg_tmp, mulconst);
-            }
-            write_vec_element(s, tcg_tmp, rt, 0, MO_64);
-            if (is_q) {
-                write_vec_element(s, tcg_tmp, rt, 1, MO_64);
-            }
+            tcg_gen_gvec_dup_i64(scale, vec_full_reg_offset(s, rt),
+                                 (is_q + 1) * 8, vec_full_reg_size(s),
+                                 tcg_tmp);
             tcg_temp_free_i64(tcg_tmp);
-            clear_vec_high(s, is_q, rt);
         } else {
             /* Load/store one element per register */
             if (is_load) {
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

For a sequence of loads or stores from a single register,
little-endian operations can be promoted to an 8-byte op.
This can reduce the number of operations by a factor of 8.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-5-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 66 +++++++++++++++++++++++---------------
 1 file changed, 40 insertions(+), 26 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void write_vec_element_i32(DisasContext *s, TCGv_i32 tcg_src,
 
 /* Store from vector register to memory */
 static void do_vec_st(DisasContext *s, int srcidx, int element,
-                      TCGv_i64 tcg_addr, int size)
+                      TCGv_i64 tcg_addr, int size, TCGMemOp endian)
 {
-    TCGMemOp memop = s->be_data + size;
     TCGv_i64 tcg_tmp = tcg_temp_new_i64();
 
     read_vec_element(s, tcg_tmp, srcidx, element, size);
-    tcg_gen_qemu_st_i64(tcg_tmp, tcg_addr, get_mem_index(s), memop);
+    tcg_gen_qemu_st_i64(tcg_tmp, tcg_addr, get_mem_index(s), endian | size);
 
     tcg_temp_free_i64(tcg_tmp);
 }
 
 /* Load from memory to vector register */
 static void do_vec_ld(DisasContext *s, int destidx, int element,
-                      TCGv_i64 tcg_addr, int size)
+                      TCGv_i64 tcg_addr, int size, TCGMemOp endian)
 {
-    TCGMemOp memop = s->be_data + size;
     TCGv_i64 tcg_tmp = tcg_temp_new_i64();
 
-    tcg_gen_qemu_ld_i64(tcg_tmp, tcg_addr, get_mem_index(s), memop);
+    tcg_gen_qemu_ld_i64(tcg_tmp, tcg_addr, get_mem_index(s), endian | size);
     write_vec_element(s, tcg_tmp, destidx, element, size);
 
     tcg_temp_free_i64(tcg_tmp);
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
     bool is_postidx = extract32(insn, 23, 1);
     bool is_q = extract32(insn, 30, 1);
     TCGv_i64 tcg_addr, tcg_rn, tcg_ebytes;
+    TCGMemOp endian = s->be_data;
 
-    int ebytes = 1 << size;
-    int elements = (is_q ? 128 : 64) / (8 << size);
+    int ebytes;   /* bytes per element */
+    int elements; /* elements per vector */
     int rpt;    /* num iterations */
     int selem;  /* structure elements */
     int r;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
         gen_check_sp_alignment(s);
     }
 
+    /* For our purposes, bytes are always little-endian.  */
+    if (size == 0) {
+        endian = MO_LE;
+    }
+
+    /* Consecutive little-endian elements from a single register
+     * can be promoted to a larger little-endian operation.
+     */
+    if (selem == 1 && endian == MO_LE) {
+        size = 3;
+    }
+    ebytes = 1 << size;
+    elements = (is_q ? 16 : 8) / ebytes;
+
     tcg_rn = cpu_reg_sp(s, rn);
     tcg_addr = tcg_temp_new_i64();
     tcg_gen_mov_i64(tcg_addr, tcg_rn);
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
     for (r = 0; r < rpt; r++) {
         int e;
         for (e = 0; e < elements; e++) {
-            int tt = (rt + r) % 32;
             int xs;
             for (xs = 0; xs < selem; xs++) {
+                int tt = (rt + r + xs) % 32;
                 if (is_store) {
-                    do_vec_st(s, tt, e, tcg_addr, size);
+                    do_vec_st(s, tt, e, tcg_addr, size, endian);
                 } else {
-                    do_vec_ld(s, tt, e, tcg_addr, size);
-
-                    /* For non-quad operations, setting a slice of the low
-                     * 64 bits of the register clears the high 64 bits (in
-                     * the ARM ARM pseudocode this is implicit in the fact
-                     * that 'rval' is a 64 bit wide variable).
-                     * For quad operations, we might still need to zero the
-                     * high bits of SVE.  We optimize by noticing that we only
-                     * need to do this the first time we touch a register.
-                     */
-                    if (e == 0 && (r == 0 || xs == selem - 1)) {
-                        clear_vec_high(s, is_q, tt);
-                    }
+                    do_vec_ld(s, tt, e, tcg_addr, size, endian);
                 }
                 tcg_gen_add_i64(tcg_addr, tcg_addr, tcg_ebytes);
-                tt = (tt + 1) % 32;
             }
         }
     }
 
+    if (!is_store) {
+        /* For non-quad operations, setting a slice of the low
+         * 64 bits of the register clears the high 64 bits (in
+         * the ARM ARM pseudocode this is implicit in the fact
+         * that 'rval' is a 64 bit wide variable).
+         * For quad operations, we might still need to zero the
+         * high bits of SVE.
+         */
+        for (r = 0; r < rpt * selem; r++) {
+            int tt = (rt + r) % 32;
+            clear_vec_high(s, is_q, tt);
+        }
+    }
+
     if (is_postidx) {
         int rm = extract32(insn, 16, 5);
         if (rm == 31) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
         } else {
             /* Load/store one element per register */
             if (is_load) {
-                do_vec_ld(s, rt, index, tcg_addr, scale);
+                do_vec_ld(s, rt, index, tcg_addr, scale, s->be_data);
             } else {
-                do_vec_st(s, rt, index, tcg_addr, scale);
+                do_vec_st(s, rt, index, tcg_addr, scale, s->be_data);
             }
         }
         tcg_gen_add_i64(tcg_addr, tcg_addr, tcg_ebytes);
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Message-id: 20181011205206.3552-6-richard.henderson@linaro.org
[PMM: drop change to now-deleted cpu_mode_names array]
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 4 ++--
 1 file changed, 2 insertions(+), 2 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static TCGv_i64 cpu_F0d, cpu_F1d;
 
 #include "exec/gen-icount.h"
 
-static const char *regnames[] =
+static const char * const regnames[] =
     { "r0", "r1", "r2", "r3", "r4", "r5", "r6", "r7",
       "r8", "r9", "r10", "r11", "r12", "r13", "r14", "pc" };
 
@@ -XXX,XX +XXX,XX @@ static struct {
     int nregs;
     int interleave;
     int spacing;
-} neon_ls_element_type[11] = {
+} const neon_ls_element_type[11] = {
     {4, 4, 1},
     {4, 4, 2},
     {4, 1, 1},
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Also introduces neon_element_offset to find the env offset
of a specific element within a neon register.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-7-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 63 ++++++++++++++++++++++++------------------
 1 file changed, 36 insertions(+), 27 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ neon_reg_offset (int reg, int n)
     return vfp_reg_offset(0, sreg);
 }
 
+/* Return the offset of a 2**SIZE piece of a NEON register, at index ELE,
+ * where 0 is the least significant end of the register.
+ */
+static inline long
+neon_element_offset(int reg, int element, TCGMemOp size)
+{
+    int element_size = 1 << size;
+    int ofs = element * element_size;
+#ifdef HOST_WORDS_BIGENDIAN
+    /* Calculate the offset assuming fully little-endian,
+     * then XOR to account for the order of the 8-byte units.
+     */
+    if (element_size < 8) {
+        ofs ^= 8 - element_size;
+    }
+#endif
+    return neon_reg_offset(reg, 0) + ofs;
+}
+
 static TCGv_i32 neon_load_reg(int reg, int pass)
 {
     TCGv_i32 tmp = tcg_temp_new_i32();
@@ -XXX,XX +XXX,XX @@ static int disas_vfp_insn(DisasContext *s, uint32_t insn)
                     tmp = load_reg(s, rd);
                     if (insn & (1 << 23)) {
                         /* VDUP */
-                        if (size == 0) {
-                            gen_neon_dup_u8(tmp, 0);
-                        } else if (size == 1) {
-                            gen_neon_dup_low16(tmp);
-                        }
-                        for (n = 0; n <= pass * 2; n++) {
-                            tmp2 = tcg_temp_new_i32();
-                            tcg_gen_mov_i32(tmp2, tmp);
-                            neon_store_reg(rn, n, tmp2);
-                        }
-                        neon_store_reg(rn, n, tmp);
+                        int vec_size = pass ? 16 : 8;
+                        tcg_gen_gvec_dup_i32(size, neon_reg_offset(rn, 0),
+                                             vec_size, vec_size, tmp);
+                        tcg_temp_free_i32(tmp);
                     } else {
                         /* VMOV */
                         switch (size) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 tcg_temp_free_i32(tmp);
             } else if ((insn & 0x380) == 0) {
                 /* VDUP */
+                int element;
+                TCGMemOp size;
+
                 if ((insn & (7 << 16)) == 0 || (q && (rd & 1))) {
                     return 1;
                 }
-                if (insn & (1 << 19)) {
-                    tmp = neon_load_reg(rm, 1);
-                } else {
-                    tmp = neon_load_reg(rm, 0);
-                }
                 if (insn & (1 << 16)) {
-                    gen_neon_dup_u8(tmp, ((insn >> 17) & 3) * 8);
+                    size = MO_8;
+                    element = (insn >> 17) & 7;
                 } else if (insn & (1 << 17)) {
-                    if ((insn >> 18) & 1)
-                        gen_neon_dup_high16(tmp);
-                    else
-                        gen_neon_dup_low16(tmp);
+                    size = MO_16;
+                    element = (insn >> 18) & 3;
+                } else {
+                    size = MO_32;
+                    element = (insn >> 19) & 1;
                 }
-                for (pass = 0; pass < (q ? 4 : 2); pass++) {
-                    tmp2 = tcg_temp_new_i32();
-                    tcg_gen_mov_i32(tmp2, tmp);
-                    neon_store_reg(rd, pass, tmp2);
-                }
-                tcg_temp_free_i32(tmp);
+                tcg_gen_gvec_dup_mem(size, neon_reg_offset(rd, 0),
+                                     neon_element_offset(rm, element, size),
+                                     q ? 16 : 8, q ? 16 : 8);
             } else {
                 return 1;
             }
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-8-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 67 ++++++++++++++++++++++++------------------
 1 file changed, 39 insertions(+), 28 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 return 1;
             }
         } else { /* (insn & 0x00380080) == 0 */
-            int invert;
+            int invert, reg_ofs, vec_size;
+
             if (q && (rd & 1)) {
                 return 1;
             }
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 break;
             case 14:
                 imm |= (imm << 8) | (imm << 16) | (imm << 24);
-                if (invert)
+                if (invert) {
                     imm = ~imm;
+                }
                 break;
             case 15:
                 if (invert) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                       | ((imm & 0x40) ? (0x1f << 25) : (1 << 30));
                 break;
             }
-            if (invert)
+            if (invert) {
                 imm = ~imm;
+            }
 
-            for (pass = 0; pass < (q ? 4 : 2); pass++) {
-                if (op & 1 && op < 12) {
-                    tmp = neon_load_reg(rd, pass);
-                    if (invert) {
-                        /* The immediate value has already been inverted, so
-                           BIC becomes AND.  */
-                        tcg_gen_andi_i32(tmp, tmp, imm);
-                    } else {
-                        tcg_gen_ori_i32(tmp, tmp, imm);
-                    }
+            reg_ofs = neon_reg_offset(rd, 0);
+            vec_size = q ? 16 : 8;
+
+            if (op & 1 && op < 12) {
+                if (invert) {
+                    /* The immediate value has already been inverted,
+                     * so BIC becomes AND.
+                     */
+                    tcg_gen_gvec_andi(MO_32, reg_ofs, reg_ofs, imm,
+                                      vec_size, vec_size);
                 } else {
-                    /* VMOV, VMVN.  */
-                    tmp = tcg_temp_new_i32();
-                    if (op == 14 && invert) {
-                        int n;
-                        uint32_t val;
-                        val = 0;
-                        for (n = 0; n < 4; n++) {
-                            if (imm & (1 << (n + (pass & 1) * 4)))
-                                val |= 0xff << (n * 8);
-                        }
-                        tcg_gen_movi_i32(tmp, val);
-                    } else {
-                        tcg_gen_movi_i32(tmp, imm);
-                    }
+                    tcg_gen_gvec_ori(MO_32, reg_ofs, reg_ofs, imm,
+                                     vec_size, vec_size);
+                }
+            } else {
+                /* VMOV, VMVN.  */
+                if (op == 14 && invert) {
+                    TCGv_i64 t64 = tcg_temp_new_i64();
+
+                    for (pass = 0; pass <= q; ++pass) {
+                        uint64_t val = 0;
+                        int n;
+
+                        for (n = 0; n < 8; n++) {
+                            if (imm & (1 << (n + pass * 8))) {
+                                val |= 0xffull << (n * 8);
+                            }
+                        }
+                        tcg_gen_movi_i64(t64, val);
+                        neon_store_reg64(t64, rd + pass);
+                    }
+                    tcg_temp_free_i64(t64);
+                } else {
+                    tcg_gen_gvec_dup32i(reg_ofs, vec_size, vec_size, imm);
                 }
-                neon_store_reg(rd, pass, tmp);
             }
         }
     } else { /* (insn & 0x00800010 == 0x00800000) */
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Move expanders for VBSL, VBIT, and VBIF from translate-a64.c.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-9-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.h     |   6 ++
 target/arm/translate-a64.c |  61 --------------
 target/arm/translate.c     | 162 +++++++++++++++++++++++++++----------
 3 files changed, 124 insertions(+), 105 deletions(-)

diff --git a/target/arm/translate.h b/target/arm/translate.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.h
+++ b/target/arm/translate.h
@@ -XXX,XX +XXX,XX @@ static inline TCGv_i32 get_ahp_flag(void)
     return ret;
 }
 
+
+/* Vector operations shared between ARM and AArch64.  */
+extern const GVecGen3 bsl_op;
+extern const GVecGen3 bit_op;
+extern const GVecGen3 bif_op;
+
 /*
  * Forward to the isar_feature_* tests given a DisasContext pointer.
  */
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_diff(DisasContext *s, uint32_t insn)
     }
 }
 
-static void gen_bsl_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
-{
-    tcg_gen_xor_i64(rn, rn, rm);
-    tcg_gen_and_i64(rn, rn, rd);
-    tcg_gen_xor_i64(rd, rm, rn);
-}
-
-static void gen_bit_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
-{
-    tcg_gen_xor_i64(rn, rn, rd);
-    tcg_gen_and_i64(rn, rn, rm);
-    tcg_gen_xor_i64(rd, rd, rn);
-}
-
-static void gen_bif_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
-{
-    tcg_gen_xor_i64(rn, rn, rd);
-    tcg_gen_andc_i64(rn, rn, rm);
-    tcg_gen_xor_i64(rd, rd, rn);
-}
-
-static void gen_bsl_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
-{
-    tcg_gen_xor_vec(vece, rn, rn, rm);
-    tcg_gen_and_vec(vece, rn, rn, rd);
-    tcg_gen_xor_vec(vece, rd, rm, rn);
-}
-
-static void gen_bit_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
-{
-    tcg_gen_xor_vec(vece, rn, rn, rd);
-    tcg_gen_and_vec(vece, rn, rn, rm);
-    tcg_gen_xor_vec(vece, rd, rd, rn);
-}
-
-static void gen_bif_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
-{
-    tcg_gen_xor_vec(vece, rn, rn, rd);
-    tcg_gen_andc_vec(vece, rn, rn, rm);
-    tcg_gen_xor_vec(vece, rd, rd, rn);
-}
-
 /* Logic op (opcode == 3) subgroup of C3.6.16. */
 static void disas_simd_3same_logic(DisasContext *s, uint32_t insn)
 {
-    static const GVecGen3 bsl_op = {
-        .fni8 = gen_bsl_i64,
-        .fniv = gen_bsl_vec,
-        .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-        .load_dest = true
-    };
-    static const GVecGen3 bit_op = {
-        .fni8 = gen_bit_i64,
-        .fniv = gen_bit_vec,
-        .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-        .load_dest = true
-    };
-    static const GVecGen3 bif_op = {
-        .fni8 = gen_bif_i64,
-        .fniv = gen_bif_vec,
-        .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-        .load_dest = true
-    };
-
     int rd = extract32(insn, 0, 5);
     int rn = extract32(insn, 5, 5);
     int rm = extract32(insn, 16, 5);
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
     return 0;
 }
 
-/* Bitwise select.  dest = c ? t : f.  Clobbers T and F.  */
-static void gen_neon_bsl(TCGv_i32 dest, TCGv_i32 t, TCGv_i32 f, TCGv_i32 c)
-{
-    tcg_gen_and_i32(t, t, c);
-    tcg_gen_andc_i32(f, f, c);
-    tcg_gen_or_i32(dest, t, f);
-}
-
 static inline void gen_neon_narrow(int size, TCGv_i32 dest, TCGv_i64 src)
 {
     switch (size) {
@@ -XXX,XX +XXX,XX @@ static int do_v81_helper(DisasContext *s, gen_helper_gvec_3_ptr *fn,
     return 1;
 }
 
+/*
+ * Expanders for VBitOps_VBIF, VBIT, VBSL.
+ */
+static void gen_bsl_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
+{
+    tcg_gen_xor_i64(rn, rn, rm);
+    tcg_gen_and_i64(rn, rn, rd);
+    tcg_gen_xor_i64(rd, rm, rn);
+}
+
+static void gen_bit_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
+{
+    tcg_gen_xor_i64(rn, rn, rd);
+    tcg_gen_and_i64(rn, rn, rm);
+    tcg_gen_xor_i64(rd, rd, rn);
+}
+
+static void gen_bif_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
+{
+    tcg_gen_xor_i64(rn, rn, rd);
+    tcg_gen_andc_i64(rn, rn, rm);
+    tcg_gen_xor_i64(rd, rd, rn);
+}
+
+static void gen_bsl_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
+{
+    tcg_gen_xor_vec(vece, rn, rn, rm);
+    tcg_gen_and_vec(vece, rn, rn, rd);
+    tcg_gen_xor_vec(vece, rd, rm, rn);
+}
+
+static void gen_bit_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
+{
+    tcg_gen_xor_vec(vece, rn, rn, rd);
+    tcg_gen_and_vec(vece, rn, rn, rm);
+    tcg_gen_xor_vec(vece, rd, rd, rn);
+}
+
+static void gen_bif_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
+{
+    tcg_gen_xor_vec(vece, rn, rn, rd);
+    tcg_gen_andc_vec(vece, rn, rn, rm);
+    tcg_gen_xor_vec(vece, rd, rd, rn);
+}
+
+const GVecGen3 bsl_op = {
+    .fni8 = gen_bsl_i64,
+    .fniv = gen_bsl_vec,
+    .prefer_i64 = TCG_TARGET_REG_BITS == 64,
+    .load_dest = true
+};
+
+const GVecGen3 bit_op = {
+    .fni8 = gen_bit_i64,
+    .fniv = gen_bit_vec,
+    .prefer_i64 = TCG_TARGET_REG_BITS == 64,
+    .load_dest = true
+};
+
+const GVecGen3 bif_op = {
+    .fni8 = gen_bif_i64,
+    .fniv = gen_bif_vec,
+    .prefer_i64 = TCG_TARGET_REG_BITS == 64,
+    .load_dest = true
+};
+
+
 /* Translate a NEON data processing instruction.  Return nonzero if the
    instruction is invalid.
    We process data in a mixture of 32-bit and 64-bit chunks.
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
 {
     int op;
     int q;
-    int rd, rn, rm;
+    int rd, rn, rm, rd_ofs, rn_ofs, rm_ofs;
     int size;
     int shift;
     int pass;
     int count;
     int pairwise;
     int u;
+    int vec_size;
     uint32_t imm, mask;
     TCGv_i32 tmp, tmp2, tmp3, tmp4, tmp5;
     TCGv_ptr ptr1, ptr2, ptr3;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
     VFP_DREG_N(rn, insn);
     VFP_DREG_M(rm, insn);
     size = (insn >> 20) & 3;
+    vec_size = q ? 16 : 8;
+    rd_ofs = neon_reg_offset(rd, 0);
+    rn_ofs = neon_reg_offset(rn, 0);
+    rm_ofs = neon_reg_offset(rm, 0);
+
     if ((insn & (1 << 23)) == 0) {
         /* Three register same length.  */
         op = ((insn >> 7) & 0x1e) | ((insn >> 4) & 1);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                                      q, rd, rn, rm);
             }
             return 1;
+
+        case NEON_3R_LOGIC: /* Logic ops.  */
+            switch ((u << 2) | size) {
+            case 0: /* VAND */
+                tcg_gen_gvec_and(0, rd_ofs, rn_ofs, rm_ofs,
+                                 vec_size, vec_size);
+                break;
+            case 1: /* VBIC */
+                tcg_gen_gvec_andc(0, rd_ofs, rn_ofs, rm_ofs,
+                                  vec_size, vec_size);
+                break;
+            case 2:
+                if (rn == rm) {
+                    /* VMOV */
+                    tcg_gen_gvec_mov(0, rd_ofs, rn_ofs, vec_size, vec_size);
+                } else {
+                    /* VORR */
+                    tcg_gen_gvec_or(0, rd_ofs, rn_ofs, rm_ofs,
+                                    vec_size, vec_size);
+                }
+                break;
+            case 3: /* VORN */
+                tcg_gen_gvec_orc(0, rd_ofs, rn_ofs, rm_ofs,
+                                 vec_size, vec_size);
+                break;
+            case 4: /* VEOR */
+                tcg_gen_gvec_xor(0, rd_ofs, rn_ofs, rm_ofs,
+                                 vec_size, vec_size);
+                break;
+            case 5: /* VBSL */
+                tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs,
+                               vec_size, vec_size, &bsl_op);
+                break;
+            case 6: /* VBIT */
+                tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs,
+                               vec_size, vec_size, &bit_op);
+                break;
+            case 7: /* VBIF */
+                tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs,
+                               vec_size, vec_size, &bif_op);
+                break;
+            }
+            return 0;
         }
-        if (size == 3 && op != NEON_3R_LOGIC) {
+        if (size == 3) {
             /* 64-bit element instructions. */
             for (pass = 0; pass < (q ? 2 : 1); pass++) {
                 neon_load_reg64(cpu_V0, rn + pass);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
         case NEON_3R_VRHADD:
             GEN_NEON_INTEGER_OP(rhadd);
             break;
-        case NEON_3R_LOGIC: /* Logic ops.  */
-            switch ((u << 2) | size) {
-            case 0: /* VAND */
-                tcg_gen_and_i32(tmp, tmp, tmp2);
-                break;
-            case 1: /* BIC */
-                tcg_gen_andc_i32(tmp, tmp, tmp2);
-                break;
-            case 2: /* VORR */
-                tcg_gen_or_i32(tmp, tmp, tmp2);
-                break;
-            case 3: /* VORN */
-                tcg_gen_orc_i32(tmp, tmp, tmp2);
-                break;
-            case 4: /* VEOR */
-                tcg_gen_xor_i32(tmp, tmp, tmp2);
-                break;
-            case 5: /* VBSL */
-                tmp3 = neon_load_reg(rd, pass);
-                gen_neon_bsl(tmp, tmp, tmp2, tmp3);
-                tcg_temp_free_i32(tmp3);
-                break;
-            case 6: /* VBIT */
-                tmp3 = neon_load_reg(rd, pass);
-                gen_neon_bsl(tmp, tmp, tmp3, tmp2);
-                tcg_temp_free_i32(tmp3);
-                break;
-            case 7: /* VBIF */
-                tmp3 = neon_load_reg(rd, pass);
-                gen_neon_bsl(tmp, tmp3, tmp, tmp2);
-                tcg_temp_free_i32(tmp3);
-                break;
-            }
-            break;
         case NEON_3R_VHSUB:
             GEN_NEON_INTEGER_OP(hsub);
             break;
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-10-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 29 ++++++++++-------------------
 1 file changed, 10 insertions(+), 19 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 break;
             }
             return 0;
+
+        case NEON_3R_VADD_VSUB:
+            if (u) {
+                tcg_gen_gvec_sub(size, rd_ofs, rn_ofs, rm_ofs,
+                                 vec_size, vec_size);
+            } else {
+                tcg_gen_gvec_add(size, rd_ofs, rn_ofs, rm_ofs,
+                                 vec_size, vec_size);
+            }
+            return 0;
         }
         if (size == 3) {
             /* 64-bit element instructions. */
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                                                   cpu_V1, cpu_V0);
                     }
                     break;
-                case NEON_3R_VADD_VSUB:
-                    if (u) {
-                        tcg_gen_sub_i64(CPU_V001);
-                    } else {
-                        tcg_gen_add_i64(CPU_V001);
-                    }
-                    break;
                 default:
                     abort();
                 }
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
             tmp2 = neon_load_reg(rd, pass);
             gen_neon_add(size, tmp, tmp2);
             break;
-        case NEON_3R_VADD_VSUB:
-            if (!u) { /* VADD */
-                gen_neon_add(size, tmp, tmp2);
-            } else { /* VSUB */
-                switch (size) {
-                case 0: gen_helper_neon_sub_u8(tmp, tmp, tmp2); break;
-                case 1: gen_helper_neon_sub_u16(tmp, tmp, tmp2); break;
-                case 2: tcg_gen_sub_i32(tmp, tmp, tmp2); break;
-                default: abort();
-                }
-            }
-            break;
         case NEON_3R_VTST_VCEQ:
             if (!u) { /* VTST */
                 switch (size) {
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-11-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 16 ++++++++--------
 1 file changed, 8 insertions(+), 8 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                     tcg_temp_free_ptr(ptr1);
                     tcg_temp_free_ptr(ptr2);
                     break;
+
+                case NEON_2RM_VMVN:
+                    tcg_gen_gvec_not(0, rd_ofs, rm_ofs, vec_size, vec_size);
+                    break;
+                case NEON_2RM_VNEG:
+                    tcg_gen_gvec_neg(size, rd_ofs, rm_ofs, vec_size, vec_size);
+                    break;
+
                 default:
                 elementwise:
                     for (pass = 0; pass < (q ? 4 : 2); pass++) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                         case NEON_2RM_VCNT:
                             gen_helper_neon_cnt_u8(tmp, tmp);
                             break;
-                        case NEON_2RM_VMVN:
-                            tcg_gen_not_i32(tmp, tmp);
-                            break;
                         case NEON_2RM_VQABS:
                             switch (size) {
                             case 0:
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                             default: abort();
                             }
                             break;
-                        case NEON_2RM_VNEG:
-                            tmp2 = tcg_const_i32(0);
-                            gen_neon_rsb(size, tmp, tmp2);
-                            tcg_temp_free_i32(tmp2);
-                            break;
                         case NEON_2RM_VCGT0_F:
                         {
                             TCGv_ptr fpstatus = get_fpstatus_ptr(1);
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-12-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 31 +++++++++++++++----------------
 1 file changed, 15 insertions(+), 16 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                                  vec_size, vec_size);
             }
             return 0;
+
+        case NEON_3R_VMUL: /* VMUL */
+            if (u) {
+                /* Polynomial case allows only P8 and is handled below.  */
+                if (size != 0) {
+                    return 1;
+                }
+            } else {
+                tcg_gen_gvec_mul(size, rd_ofs, rn_ofs, rm_ofs,
+                                 vec_size, vec_size);
+                return 0;
+            }
+            break;
         }
         if (size == 3) {
             /* 64-bit element instructions. */
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 return 1;
             }
             break;
-        case NEON_3R_VMUL:
-            if (u && (size != 0)) {
-                /* UNDEF on invalid size for polynomial subcase */
-                return 1;
-            }
-            break;
         case NEON_3R_VFM_VQRDMLSH:
             if (!arm_dc_feature(s, ARM_FEATURE_VFP4)) {
                 return 1;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
             }
             break;
         case NEON_3R_VMUL:
-            if (u) { /* polynomial */
-                gen_helper_neon_mul_p8(tmp, tmp, tmp2);
-            } else { /* Integer */
-                switch (size) {
-                case 0: gen_helper_neon_mul_u8(tmp, tmp, tmp2); break;
-                case 1: gen_helper_neon_mul_u16(tmp, tmp, tmp2); break;
-                case 2: tcg_gen_mul_i32(tmp, tmp, tmp2); break;
-                default: abort();
-                }
-            }
+            /* VMUL.P8; other cases already eliminated.  */
+            gen_helper_neon_mul_p8(tmp, tmp, tmp2);
             break;
         case NEON_3R_VPMAX:
             GEN_NEON_INTEGER_OP(pmax);
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-13-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 70 +++++++++++++++++++++++++++++-------------
 1 file changed, 48 insertions(+), 22 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                     size--;
             }
             shift = (insn >> 16) & ((1 << (3 + size)) - 1);
-            /* To avoid excessive duplication of ops we implement shift
-               by immediate using the variable shift operations.  */
             if (op < 8) {
                 /* Shift by immediate:
                    VSHR, VSRA, VRSHR, VRSRA, VSRI, VSHL, VQSHL, VQSHLU.  */
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 }
                 /* Right shifts are encoded as N - shift, where N is the
                    element size in bits.  */
-                if (op <= 4)
+                if (op <= 4) {
                     shift = shift - (1 << (size + 3));
+                }
+
+                switch (op) {
+                case 0:  /* VSHR */
+                    /* Right shift comes here negative.  */
+                    shift = -shift;
+                    /* Shifts larger than the element size are architecturally
+                     * valid.  Unsigned results in all zeros; signed results
+                     * in all sign bits.
+                     */
+                    if (!u) {
+                        tcg_gen_gvec_sari(size, rd_ofs, rm_ofs,
+                                          MIN(shift, (8 << size) - 1),
+                                          vec_size, vec_size);
+                    } else if (shift >= 8 << size) {
+                        tcg_gen_gvec_dup8i(rd_ofs, vec_size, vec_size, 0);
+                    } else {
+                        tcg_gen_gvec_shri(size, rd_ofs, rm_ofs, shift,
+                                          vec_size, vec_size);
+                    }
+                    return 0;
+
+                case 5: /* VSHL, VSLI */
+                    if (!u) { /* VSHL */
+                        /* Shifts larger than the element size are
+                         * architecturally valid and results in zero.
+                         */
+                        if (shift >= 8 << size) {
+                            tcg_gen_gvec_dup8i(rd_ofs, vec_size, vec_size, 0);
+                        } else {
+                            tcg_gen_gvec_shli(size, rd_ofs, rm_ofs, shift,
+                                              vec_size, vec_size);
+                        }
+                        return 0;
+                    }
+                    break;
+                }
+
                 if (size == 3) {
                     count = q + 1;
                 } else {
                     count = q ? 4: 2;
                 }
-                switch (size) {
-                case 0:
-                    imm = (uint8_t) shift;
-                    imm |= imm << 8;
-                    imm |= imm << 16;
-                    break;
-                case 1:
-                    imm = (uint16_t) shift;
-                    imm |= imm << 16;
-                    break;
-                case 2:
-                case 3:
-                    imm = shift;
-                    break;
-                default:
-                    abort();
-                }
+
+                /* To avoid excessive duplication of ops we implement shift
+                 * by immediate using the variable shift operations.
+                  */
+                imm = dup_const(size, shift);
 
                 for (pass = 0; pass < count; pass++) {
                     if (size == 3) {
                         neon_load_reg64(cpu_V0, rm + pass);
                         tcg_gen_movi_i64(cpu_V1, imm);
                         switch (op) {
-                        case 0:  /* VSHR */
                         case 1:  /* VSRA */
                             if (u)
                                 gen_helper_neon_shl_u64(cpu_V0, cpu_V0, cpu_V1);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                                                          cpu_V0, cpu_V1);
                             }
                             break;
+                        default:
+                            g_assert_not_reached();
                         }
                         if (op == 1 || op == 3) {
                             /* Accumulate.  */
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                         tmp2 = tcg_temp_new_i32();
                         tcg_gen_movi_i32(tmp2, imm);
                         switch (op) {
-                        case 0:  /* VSHR */
                         case 1:  /* VSRA */
                             GEN_NEON_INTEGER_OP(shl);
                             break;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                         case 7: /* VQSHL */
                             GEN_NEON_INTEGER_OP_ENV(qshl);
                             break;
+                        default:
+                            g_assert_not_reached();
                         }
                         tcg_temp_free_i32(tmp2);
 
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Move ssra_op and usra_op expanders from translate-a64.c.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-14-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.h     |   2 +
 target/arm/translate-a64.c | 106 ----------------------------
 target/arm/translate.c     | 139 ++++++++++++++++++++++++++++++++++---
 3 files changed, 130 insertions(+), 117 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Move shi_op and sli_op expanders from translate-a64.c.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-15-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.h     |   2 +
 target/arm/translate-a64.c | 152 +----------------------
 target/arm/translate.c     | 244 ++++++++++++++++++++++++++-----------
 3 files changed, 179 insertions(+), 219 deletions(-)

diff --git a/target/arm/translate.h b/target/arm/translate.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.h
+++ b/target/arm/translate.h
@@ -XXX,XX +XXX,XX @@ extern const GVecGen3 bit_op;
 extern const GVecGen3 bif_op;
 extern const GVecGen2i ssra_op[4];
 extern const GVecGen2i usra_op[4];
+extern const GVecGen2i sri_op[4];
+extern const GVecGen2i sli_op[4];
 
 /*
  * Forward to the isar_feature_* tests given a DisasContext pointer.
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_two_reg_misc(DisasContext *s, uint32_t insn)
     }
 }
 
-static void gen_shr8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-{
-    uint64_t mask = dup_const(MO_8, 0xff >> shift);
-    TCGv_i64 t = tcg_temp_new_i64();
-
-    tcg_gen_shri_i64(t, a, shift);
-    tcg_gen_andi_i64(t, t, mask);
-    tcg_gen_andi_i64(d, d, ~mask);
-    tcg_gen_or_i64(d, d, t);
-    tcg_temp_free_i64(t);
-}
-
-static void gen_shr16_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-{
-    uint64_t mask = dup_const(MO_16, 0xffff >> shift);
-    TCGv_i64 t = tcg_temp_new_i64();
-
-    tcg_gen_shri_i64(t, a, shift);
-    tcg_gen_andi_i64(t, t, mask);
-    tcg_gen_andi_i64(d, d, ~mask);
-    tcg_gen_or_i64(d, d, t);
-    tcg_temp_free_i64(t);
-}
-
-static void gen_shr32_ins_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
-{
-    tcg_gen_shri_i32(a, a, shift);
-    tcg_gen_deposit_i32(d, d, a, 0, 32 - shift);
-}
-
-static void gen_shr64_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-{
-    tcg_gen_shri_i64(a, a, shift);
-    tcg_gen_deposit_i64(d, d, a, 0, 64 - shift);
-}
-
-static void gen_shr_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
-{
-    uint64_t mask = (2ull << ((8 << vece) - 1)) - 1;
-    TCGv_vec t = tcg_temp_new_vec_matching(d);
-    TCGv_vec m = tcg_temp_new_vec_matching(d);
-
-    tcg_gen_dupi_vec(vece, m, mask ^ (mask >> sh));
-    tcg_gen_shri_vec(vece, t, a, sh);
-    tcg_gen_and_vec(vece, d, d, m);
-    tcg_gen_or_vec(vece, d, d, t);
-
-    tcg_temp_free_vec(t);
-    tcg_temp_free_vec(m);
-}
-
 /* SSHR[RA]/USHR[RA] - Vector shift right (optional rounding/accumulate) */
 static void handle_vec_simd_shri(DisasContext *s, bool is_q, bool is_u,
                                  int immh, int immb, int opcode, int rn, int rd)
 {
-    static const GVecGen2i sri_op[4] = {
-        { .fni8 = gen_shr8_ins_i64,
-          .fniv = gen_shr_ins_vec,
-          .load_dest = true,
-          .opc = INDEX_op_shri_vec,
-          .vece = MO_8 },
-        { .fni8 = gen_shr16_ins_i64,
-          .fniv = gen_shr_ins_vec,
-          .load_dest = true,
-          .opc = INDEX_op_shri_vec,
-          .vece = MO_16 },
-        { .fni4 = gen_shr32_ins_i32,
-          .fniv = gen_shr_ins_vec,
-          .load_dest = true,
-          .opc = INDEX_op_shri_vec,
-          .vece = MO_32 },
-        { .fni8 = gen_shr64_ins_i64,
-          .fniv = gen_shr_ins_vec,
-          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-          .load_dest = true,
-          .opc = INDEX_op_shri_vec,
-          .vece = MO_64 },
-    };
-
     int size = 32 - clz32(immh) - 1;
     int immhb = immh << 3 | immb;
     int shift = 2 * (8 << size) - immhb;
@@ -XXX,XX +XXX,XX @@ static void handle_vec_simd_shri(DisasContext *s, bool is_q, bool is_u,
     clear_vec_high(s, is_q, rd);
 }
 
-static void gen_shl8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-{
-    uint64_t mask = dup_const(MO_8, 0xff << shift);
-    TCGv_i64 t = tcg_temp_new_i64();
-
-    tcg_gen_shli_i64(t, a, shift);
-    tcg_gen_andi_i64(t, t, mask);
-    tcg_gen_andi_i64(d, d, ~mask);
-    tcg_gen_or_i64(d, d, t);
-    tcg_temp_free_i64(t);
-}
-
-static void gen_shl16_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-{
-    uint64_t mask = dup_const(MO_16, 0xffff << shift);
-    TCGv_i64 t = tcg_temp_new_i64();
-
-    tcg_gen_shli_i64(t, a, shift);
-    tcg_gen_andi_i64(t, t, mask);
-    tcg_gen_andi_i64(d, d, ~mask);
-    tcg_gen_or_i64(d, d, t);
-    tcg_temp_free_i64(t);
-}
-
-static void gen_shl32_ins_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
-{
-    tcg_gen_deposit_i32(d, d, a, shift, 32 - shift);
-}
-
-static void gen_shl64_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-{
-    tcg_gen_deposit_i64(d, d, a, shift, 64 - shift);
-}
-
-static void gen_shl_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
-{
-    uint64_t mask = (1ull << sh) - 1;
-    TCGv_vec t = tcg_temp_new_vec_matching(d);
-    TCGv_vec m = tcg_temp_new_vec_matching(d);
-
-    tcg_gen_dupi_vec(vece, m, mask);
-    tcg_gen_shli_vec(vece, t, a, sh);
-    tcg_gen_and_vec(vece, d, d, m);
-    tcg_gen_or_vec(vece, d, d, t);
-
-    tcg_temp_free_vec(t);
-    tcg_temp_free_vec(m);
-}
-
 /* SHL/SLI - Vector shift left */
 static void handle_vec_simd_shli(DisasContext *s, bool is_q, bool insert,
                                  int immh, int immb, int opcode, int rn, int rd)
 {
-    static const GVecGen2i shi_op[4] = {
-        { .fni8 = gen_shl8_ins_i64,
-          .fniv = gen_shl_ins_vec,
-          .opc = INDEX_op_shli_vec,
-          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-          .load_dest = true,
-          .vece = MO_8 },
-        { .fni8 = gen_shl16_ins_i64,
-          .fniv = gen_shl_ins_vec,
-          .opc = INDEX_op_shli_vec,
-          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-          .load_dest = true,
-          .vece = MO_16 },
-        { .fni4 = gen_shl32_ins_i32,
-          .fniv = gen_shl_ins_vec,
-          .opc = INDEX_op_shli_vec,
-          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-          .load_dest = true,
-          .vece = MO_32 },
-        { .fni8 = gen_shl64_ins_i64,
-          .fniv = gen_shl_ins_vec,
-          .opc = INDEX_op_shli_vec,
-          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-          .load_dest = true,
-          .vece = MO_64 },
-    };
     int size = 32 - clz32(immh) - 1;
     int immhb = immh << 3 | immb;
     int shift = immhb - (8 << size);
@@ -XXX,XX +XXX,XX @@ static void handle_vec_simd_shli(DisasContext *s, bool is_q, bool insert,
     }
 
     if (insert) {
-        gen_gvec_op2i(s, is_q, rd, rn, shift, &shi_op[size]);
+        gen_gvec_op2i(s, is_q, rd, rn, shift, &sli_op[size]);
     } else {
         gen_gvec_fn2i(s, is_q, rd, rn, shift, tcg_gen_gvec_shli, size);
     }
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ const GVecGen2i usra_op[4] = {
       .vece = MO_64, },
 };
 
+static void gen_shr8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+{
+    uint64_t mask = dup_const(MO_8, 0xff >> shift);
+    TCGv_i64 t = tcg_temp_new_i64();
+
+    tcg_gen_shri_i64(t, a, shift);
+    tcg_gen_andi_i64(t, t, mask);
+    tcg_gen_andi_i64(d, d, ~mask);
+    tcg_gen_or_i64(d, d, t);
+    tcg_temp_free_i64(t);
+}
+
+static void gen_shr16_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+{
+    uint64_t mask = dup_const(MO_16, 0xffff >> shift);
+    TCGv_i64 t = tcg_temp_new_i64();
+
+    tcg_gen_shri_i64(t, a, shift);
+    tcg_gen_andi_i64(t, t, mask);
+    tcg_gen_andi_i64(d, d, ~mask);
+    tcg_gen_or_i64(d, d, t);
+    tcg_temp_free_i64(t);
+}
+
+static void gen_shr32_ins_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
+{
+    tcg_gen_shri_i32(a, a, shift);
+    tcg_gen_deposit_i32(d, d, a, 0, 32 - shift);
+}
+
+static void gen_shr64_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+{
+    tcg_gen_shri_i64(a, a, shift);
+    tcg_gen_deposit_i64(d, d, a, 0, 64 - shift);
+}
+
+static void gen_shr_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
+{
+    if (sh == 0) {
+        tcg_gen_mov_vec(d, a);
+    } else {
+        TCGv_vec t = tcg_temp_new_vec_matching(d);
+        TCGv_vec m = tcg_temp_new_vec_matching(d);
+
+        tcg_gen_dupi_vec(vece, m, MAKE_64BIT_MASK((8 << vece) - sh, sh));
+        tcg_gen_shri_vec(vece, t, a, sh);
+        tcg_gen_and_vec(vece, d, d, m);
+        tcg_gen_or_vec(vece, d, d, t);
+
+        tcg_temp_free_vec(t);
+        tcg_temp_free_vec(m);
+    }
+}
+
+const GVecGen2i sri_op[4] = {
+    { .fni8 = gen_shr8_ins_i64,
+      .fniv = gen_shr_ins_vec,
+      .load_dest = true,
+      .opc = INDEX_op_shri_vec,
+      .vece = MO_8 },
+    { .fni8 = gen_shr16_ins_i64,
+      .fniv = gen_shr_ins_vec,
+      .load_dest = true,
+      .opc = INDEX_op_shri_vec,
+      .vece = MO_16 },
+    { .fni4 = gen_shr32_ins_i32,
+      .fniv = gen_shr_ins_vec,
+      .load_dest = true,
+      .opc = INDEX_op_shri_vec,
+      .vece = MO_32 },
+    { .fni8 = gen_shr64_ins_i64,
+      .fniv = gen_shr_ins_vec,
+      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
+      .load_dest = true,
+      .opc = INDEX_op_shri_vec,
+      .vece = MO_64 },
+};
+
+static void gen_shl8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+{
+    uint64_t mask = dup_const(MO_8, 0xff << shift);
+    TCGv_i64 t = tcg_temp_new_i64();
+
+    tcg_gen_shli_i64(t, a, shift);
+    tcg_gen_andi_i64(t, t, mask);
+    tcg_gen_andi_i64(d, d, ~mask);
+    tcg_gen_or_i64(d, d, t);
+    tcg_temp_free_i64(t);
+}
+
+static void gen_shl16_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+{
+    uint64_t mask = dup_const(MO_16, 0xffff << shift);
+    TCGv_i64 t = tcg_temp_new_i64();
+
+    tcg_gen_shli_i64(t, a, shift);
+    tcg_gen_andi_i64(t, t, mask);
+    tcg_gen_andi_i64(d, d, ~mask);
+    tcg_gen_or_i64(d, d, t);
+    tcg_temp_free_i64(t);
+}
+
+static void gen_shl32_ins_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
+{
+    tcg_gen_deposit_i32(d, d, a, shift, 32 - shift);
+}
+
+static void gen_shl64_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+{
+    tcg_gen_deposit_i64(d, d, a, shift, 64 - shift);
+}
+
+static void gen_shl_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
+{
+    if (sh == 0) {
+        tcg_gen_mov_vec(d, a);
+    } else {
+        TCGv_vec t = tcg_temp_new_vec_matching(d);
+        TCGv_vec m = tcg_temp_new_vec_matching(d);
+
+        tcg_gen_dupi_vec(vece, m, MAKE_64BIT_MASK(0, sh));
+        tcg_gen_shli_vec(vece, t, a, sh);
+        tcg_gen_and_vec(vece, d, d, m);
+        tcg_gen_or_vec(vece, d, d, t);
+
+        tcg_temp_free_vec(t);
+        tcg_temp_free_vec(m);
+    }
+}
+
+const GVecGen2i sli_op[4] = {
+    { .fni8 = gen_shl8_ins_i64,
+      .fniv = gen_shl_ins_vec,
+      .load_dest = true,
+      .opc = INDEX_op_shli_vec,
+      .vece = MO_8 },
+    { .fni8 = gen_shl16_ins_i64,
+      .fniv = gen_shl_ins_vec,
+      .load_dest = true,
+      .opc = INDEX_op_shli_vec,
+      .vece = MO_16 },
+    { .fni4 = gen_shl32_ins_i32,
+      .fniv = gen_shl_ins_vec,
+      .load_dest = true,
+      .opc = INDEX_op_shli_vec,
+      .vece = MO_32 },
+    { .fni8 = gen_shl64_ins_i64,
+      .fniv = gen_shl_ins_vec,
+      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
+      .load_dest = true,
+      .opc = INDEX_op_shli_vec,
+      .vece = MO_64 },
+};
+
 /* Translate a NEON data processing instruction.  Return nonzero if the
    instruction is invalid.
    We process data in a mixture of 32-bit and 64-bit chunks.
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
     int pairwise;
     int u;
     int vec_size;
-    uint32_t imm, mask;
+    uint32_t imm;
     TCGv_i32 tmp, tmp2, tmp3, tmp4, tmp5;
     TCGv_ptr ptr1, ptr2, ptr3;
     TCGv_i64 tmp64;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                     }
                     return 0;
 
+                case 4: /* VSRI */
+                    if (!u) {
+                        return 1;
+                    }
+                    /* Right shift comes here negative.  */
+                    shift = -shift;
+                    /* Shift out of range leaves destination unchanged.  */
+                    if (shift < 8 << size) {
+                        tcg_gen_gvec_2i(rd_ofs, rm_ofs, vec_size, vec_size,
+                                        shift, &sri_op[size]);
+                    }
+                    return 0;
+
                 case 5: /* VSHL, VSLI */
-                    if (!u) { /* VSHL */
+                    if (u) { /* VSLI */
+                        /* Shift out of range leaves destination unchanged.  */
+                        if (shift < 8 << size) {
+                            tcg_gen_gvec_2i(rd_ofs, rm_ofs, vec_size,
+                                            vec_size, shift, &sli_op[size]);
+                        }
+                    } else { /* VSHL */
                         /* Shifts larger than the element size are
                          * architecturally valid and results in zero.
                          */
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                             tcg_gen_gvec_shli(size, rd_ofs, rm_ofs, shift,
                                               vec_size, vec_size);
                         }
-                        return 0;
                     }
-                    break;
+                    return 0;
                 }
 
                 if (size == 3) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                             else
                                 gen_helper_neon_rshl_s64(cpu_V0, cpu_V0, cpu_V1);
                             break;
-                        case 4: /* VSRI */
-                        case 5: /* VSHL, VSLI */
-                            gen_helper_neon_shl_u64(cpu_V0, cpu_V0, cpu_V1);
-                            break;
                         case 6: /* VQSHLU */
                             gen_helper_neon_qshlu_s64(cpu_V0, cpu_env,
                                                       cpu_V0, cpu_V1);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                             /* Accumulate.  */
                             neon_load_reg64(cpu_V1, rd + pass);
                             tcg_gen_add_i64(cpu_V0, cpu_V0, cpu_V1);
-                        } else if (op == 4 || (op == 5 && u)) {
-                            /* Insert */
-                            neon_load_reg64(cpu_V1, rd + pass);
-                            uint64_t mask;
-                            if (shift < -63 || shift > 63) {
-                                mask = 0;
-                            } else {
-                                if (op == 4) {
-                                    mask = 0xffffffffffffffffull >> -shift;
-                                } else {
-                                    mask = 0xffffffffffffffffull << shift;
-                                }
-                            }
-                            tcg_gen_andi_i64(cpu_V1, cpu_V1, ~mask);
-                            tcg_gen_or_i64(cpu_V0, cpu_V0, cpu_V1);
                         }
                         neon_store_reg64(cpu_V0, rd + pass);
                     } else { /* size < 3 */
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                         case 3: /* VRSRA */
                             GEN_NEON_INTEGER_OP(rshl);
                             break;
-                        case 4: /* VSRI */
-                        case 5: /* VSHL, VSLI */
-                            switch (size) {
-                            case 0: gen_helper_neon_shl_u8(tmp, tmp, tmp2); break;
-                            case 1: gen_helper_neon_shl_u16(tmp, tmp, tmp2); break;
-                            case 2: gen_helper_neon_shl_u32(tmp, tmp, tmp2); break;
-                            default: abort();
-                            }
-                            break;
                         case 6: /* VQSHLU */
                             switch (size) {
                             case 0:
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                             tmp2 = neon_load_reg(rd, pass);
                             gen_neon_add(size, tmp, tmp2);
                             tcg_temp_free_i32(tmp2);
-                        } else if (op == 4 || (op == 5 && u)) {
-                            /* Insert */
-                            switch (size) {
-                            case 0:
-                                if (op == 4)
-                                    mask = 0xff >> -shift;
-                                else
-                                    mask = (uint8_t)(0xff << shift);
-                                mask |= mask << 8;
-                                mask |= mask << 16;
-                                break;
-                            case 1:
-                                if (op == 4)
-                                    mask = 0xffff >> -shift;
-                                else
-                                    mask = (uint16_t)(0xffff << shift);
-                                mask |= mask << 16;
-                                break;
-                            case 2:
-                                if (shift < -31 || shift > 31) {
-                                    mask = 0;
-                                } else {
-                                    if (op == 4)
-                                        mask = 0xffffffffu >> -shift;
-                                    else
-                                        mask = 0xffffffffu << shift;
-                                }
-                                break;
-                            default:
-                                abort();
-                            }
-                            tmp2 = neon_load_reg(rd, pass);
-                            tcg_gen_andi_i32(tmp, tmp, mask);
-                            tcg_gen_andi_i32(tmp2, tmp2, ~mask);
-                            tcg_gen_or_i32(tmp, tmp, tmp2);
-                            tcg_temp_free_i32(tmp2);
                         }
                         neon_store_reg(rd, pass, tmp);
                     }
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Move mla_op and mls_op expanders from translate-a64.c.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-16-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.h     |   2 +
 target/arm/translate-a64.c | 106 -----------------------------
 target/arm/translate.c     | 134 ++++++++++++++++++++++++++++++++-----
 3 files changed, 120 insertions(+), 122 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Move cmtst_op expanders from translate-a64.c.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-17-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.h     |  2 +
 target/arm/translate-a64.c | 38 ------------------
 target/arm/translate.c     | 81 +++++++++++++++++++++++++++-----------
 3 files changed, 60 insertions(+), 61 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-18-richard.henderson@linaro.org
[PMM: added parens in ?: expression]
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 81 ++++++++++++++----------------------------
 1 file changed, 26 insertions(+), 55 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void gen_vfp_msr(TCGv_i32 tmp)
     tcg_temp_free_i32(tmp);
 }
 
-static void gen_neon_dup_u8(TCGv_i32 var, int shift)
-{
-    TCGv_i32 tmp = tcg_temp_new_i32();
-    if (shift)
-        tcg_gen_shri_i32(var, var, shift);
-    tcg_gen_ext8u_i32(var, var);
-    tcg_gen_shli_i32(tmp, var, 8);
-    tcg_gen_or_i32(var, var, tmp);
-    tcg_gen_shli_i32(tmp, var, 16);
-    tcg_gen_or_i32(var, var, tmp);
-    tcg_temp_free_i32(tmp);
-}
-
 static void gen_neon_dup_low16(TCGv_i32 var)
 {
     TCGv_i32 tmp = tcg_temp_new_i32();
@@ -XXX,XX +XXX,XX @@ static void gen_neon_dup_high16(TCGv_i32 var)
     tcg_temp_free_i32(tmp);
 }
 
-static TCGv_i32 gen_load_and_replicate(DisasContext *s, TCGv_i32 addr, int size)
-{
-    /* Load a single Neon element and replicate into a 32 bit TCG reg */
-    TCGv_i32 tmp = tcg_temp_new_i32();
-    switch (size) {
-    case 0:
-        gen_aa32_ld8u(s, tmp, addr, get_mem_index(s));
-        gen_neon_dup_u8(tmp, 0);
-        break;
-    case 1:
-        gen_aa32_ld16u(s, tmp, addr, get_mem_index(s));
-        gen_neon_dup_low16(tmp);
-        break;
-    case 2:
-        gen_aa32_ld32u(s, tmp, addr, get_mem_index(s));
-        break;
-    default: /* Avoid compiler warnings.  */
-        abort();
-    }
-    return tmp;
-}
-
 static int handle_vsel(uint32_t insn, uint32_t rd, uint32_t rn, uint32_t rm,
                        uint32_t dp)
 {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
     int load;
     int shift;
     int n;
+    int vec_size;
     TCGv_i32 addr;
     TCGv_i32 tmp;
     TCGv_i32 tmp2;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
             }
             addr = tcg_temp_new_i32();
             load_reg_var(s, addr, rn);
-            if (nregs == 1) {
-                /* VLD1 to all lanes: bit 5 indicates how many Dregs to write */
-                tmp = gen_load_and_replicate(s, addr, size);
-                tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd, 0));
-                tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd, 1));
-                if (insn & (1 << 5)) {
-                    tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd + 1, 0));
-                    tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd + 1, 1));
-                }
-                tcg_temp_free_i32(tmp);
-            } else {
-                /* VLD2/3/4 to all lanes: bit 5 indicates register stride */
-                stride = (insn & (1 << 5)) ? 2 : 1;
-                for (reg = 0; reg < nregs; reg++) {
-                    tmp = gen_load_and_replicate(s, addr, size);
-                    tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd, 0));
-                    tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd, 1));
-                    tcg_temp_free_i32(tmp);
-                    tcg_gen_addi_i32(addr, addr, 1 << size);
-                    rd += stride;
+
+            /* VLD1 to all lanes: bit 5 indicates how many Dregs to write.
+             * VLD2/3/4 to all lanes: bit 5 indicates register stride.
+             */
+            stride = (insn & (1 << 5)) ? 2 : 1;
+            vec_size = nregs == 1 ? stride * 8 : 8;
+
+            tmp = tcg_temp_new_i32();
+            for (reg = 0; reg < nregs; reg++) {
+                gen_aa32_ld_i32(s, tmp, addr, get_mem_index(s),
+                                s->be_data | size);
+                if ((rd & 1) && vec_size == 16) {
+                    /* We cannot write 16 bytes at once because the
+                     * destination is unaligned.
+                     */
+                    tcg_gen_gvec_dup_i32(size, neon_reg_offset(rd, 0),
+                                         8, 8, tmp);
+                    tcg_gen_gvec_mov(0, neon_reg_offset(rd + 1, 0),
+                                     neon_reg_offset(rd, 0), 8, 8);
+                } else {
+                    tcg_gen_gvec_dup_i32(size, neon_reg_offset(rd, 0),
+                                         vec_size, vec_size, tmp);
                 }
+                tcg_gen_addi_i32(addr, addr, 1 << size);
+                rd += stride;
             }
+            tcg_temp_free_i32(tmp);
             tcg_temp_free_i32(addr);
             stride = (1 << size) * nregs;
         } else {
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Instead of shifts and masks, use direct loads and stores from the neon
register file.  Mirror the iteration structure of the ARM pseudocode
more closely.  Correct the parameters of the VLD2 A2 insn.

Note that this includes a bugfix for handling of the insn
"VLD2 (multiple 2-element structures)" -- we were using an
incorrect stride value.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-19-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 170 ++++++++++++++++++-----------------------
 1 file changed, 74 insertions(+), 96 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static TCGv_i32 neon_load_reg(int reg, int pass)
     return tmp;
 }
 
+static void neon_load_element64(TCGv_i64 var, int reg, int ele, TCGMemOp mop)
+{
+    long offset = neon_element_offset(reg, ele, mop & MO_SIZE);
+
+    switch (mop) {
+    case MO_UB:
+        tcg_gen_ld8u_i64(var, cpu_env, offset);
+        break;
+    case MO_UW:
+        tcg_gen_ld16u_i64(var, cpu_env, offset);
+        break;
+    case MO_UL:
+        tcg_gen_ld32u_i64(var, cpu_env, offset);
+        break;
+    case MO_Q:
+        tcg_gen_ld_i64(var, cpu_env, offset);
+        break;
+    default:
+        g_assert_not_reached();
+    }
+}
+
 static void neon_store_reg(int reg, int pass, TCGv_i32 var)
 {
     tcg_gen_st_i32(var, cpu_env, neon_reg_offset(reg, pass));
     tcg_temp_free_i32(var);
 }
 
+static void neon_store_element64(int reg, int ele, TCGMemOp size, TCGv_i64 var)
+{
+    long offset = neon_element_offset(reg, ele, size);
+
+    switch (size) {
+    case MO_8:
+        tcg_gen_st8_i64(var, cpu_env, offset);
+        break;
+    case MO_16:
+        tcg_gen_st16_i64(var, cpu_env, offset);
+        break;
+    case MO_32:
+        tcg_gen_st32_i64(var, cpu_env, offset);
+        break;
+    case MO_64:
+        tcg_gen_st_i64(var, cpu_env, offset);
+        break;
+    default:
+        g_assert_not_reached();
+    }
+}
+
 static inline void neon_load_reg64(TCGv_i64 var, int reg)
 {
     tcg_gen_ld_i64(var, cpu_env, vfp_reg_offset(1, reg));
@@ -XXX,XX +XXX,XX @@ static struct {
     int interleave;
     int spacing;
 } const neon_ls_element_type[11] = {
-    {4, 4, 1},
-    {4, 4, 2},
+    {1, 4, 1},
+    {1, 4, 2},
     {4, 1, 1},
-    {4, 2, 1},
-    {3, 3, 1},
-    {3, 3, 2},
+    {2, 2, 2},
+    {1, 3, 1},
+    {1, 3, 2},
     {3, 1, 1},
     {1, 1, 1},
-    {2, 2, 1},
-    {2, 2, 2},
+    {1, 2, 1},
+    {1, 2, 2},
     {2, 1, 1}
 };
 
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
     int shift;
     int n;
     int vec_size;
+    int mmu_idx;
+    TCGMemOp endian;
     TCGv_i32 addr;
     TCGv_i32 tmp;
     TCGv_i32 tmp2;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
     rn = (insn >> 16) & 0xf;
     rm = insn & 0xf;
     load = (insn & (1 << 21)) != 0;
+    endian = s->be_data;
+    mmu_idx = get_mem_index(s);
     if ((insn & (1 << 23)) == 0) {
         /* Load store all elements.  */
         op = (insn >> 8) & 0xf;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
         nregs = neon_ls_element_type[op].nregs;
         interleave = neon_ls_element_type[op].interleave;
         spacing = neon_ls_element_type[op].spacing;
-        if (size == 3 && (interleave | spacing) != 1)
+        if (size == 3 && (interleave | spacing) != 1) {
             return 1;
+        }
+        tmp64 = tcg_temp_new_i64();
         addr = tcg_temp_new_i32();
+        tmp2 = tcg_const_i32(1 << size);
         load_reg_var(s, addr, rn);
-        stride = (1 << size) * interleave;
         for (reg = 0; reg < nregs; reg++) {
-            if (interleave > 2 || (interleave == 2 && nregs == 2)) {
-                load_reg_var(s, addr, rn);
-                tcg_gen_addi_i32(addr, addr, (1 << size) * reg);
-            } else if (interleave == 2 && nregs == 4 && reg == 2) {
-                load_reg_var(s, addr, rn);
-                tcg_gen_addi_i32(addr, addr, 1 << size);
-            }
-            if (size == 3) {
-                tmp64 = tcg_temp_new_i64();
-                if (load) {
-                    gen_aa32_ld64(s, tmp64, addr, get_mem_index(s));
-                    neon_store_reg64(tmp64, rd);
-                } else {
-                    neon_load_reg64(tmp64, rd);
-                    gen_aa32_st64(s, tmp64, addr, get_mem_index(s));
-                }
-                tcg_temp_free_i64(tmp64);
-                tcg_gen_addi_i32(addr, addr, stride);
-            } else {
-                for (pass = 0; pass < 2; pass++) {
-                    if (size == 2) {
-                        if (load) {
-                            tmp = tcg_temp_new_i32();
-                            gen_aa32_ld32u(s, tmp, addr, get_mem_index(s));
-                            neon_store_reg(rd, pass, tmp);
-                        } else {
-                            tmp = neon_load_reg(rd, pass);
-                            gen_aa32_st32(s, tmp, addr, get_mem_index(s));
-                            tcg_temp_free_i32(tmp);
-                        }
-                        tcg_gen_addi_i32(addr, addr, stride);
-                    } else if (size == 1) {
-                        if (load) {
-                            tmp = tcg_temp_new_i32();
-                            gen_aa32_ld16u(s, tmp, addr, get_mem_index(s));
-                            tcg_gen_addi_i32(addr, addr, stride);
-                            tmp2 = tcg_temp_new_i32();
-                            gen_aa32_ld16u(s, tmp2, addr, get_mem_index(s));
-                            tcg_gen_addi_i32(addr, addr, stride);
-                            tcg_gen_shli_i32(tmp2, tmp2, 16);
-                            tcg_gen_or_i32(tmp, tmp, tmp2);
-                            tcg_temp_free_i32(tmp2);
-                            neon_store_reg(rd, pass, tmp);
-                        } else {
-                            tmp = neon_load_reg(rd, pass);
-                            tmp2 = tcg_temp_new_i32();
-                            tcg_gen_shri_i32(tmp2, tmp, 16);
-                            gen_aa32_st16(s, tmp, addr, get_mem_index(s));
-                            tcg_temp_free_i32(tmp);
-                            tcg_gen_addi_i32(addr, addr, stride);
-                            gen_aa32_st16(s, tmp2, addr, get_mem_index(s));
-                            tcg_temp_free_i32(tmp2);
-                            tcg_gen_addi_i32(addr, addr, stride);
-                        }
-                    } else /* size == 0 */ {
-                        if (load) {
-                            tmp2 = NULL;
-                            for (n = 0; n < 4; n++) {
-                                tmp = tcg_temp_new_i32();
-                                gen_aa32_ld8u(s, tmp, addr, get_mem_index(s));
-                                tcg_gen_addi_i32(addr, addr, stride);
-                                if (n == 0) {
-                                    tmp2 = tmp;
-                                } else {
-                                    tcg_gen_shli_i32(tmp, tmp, n * 8);
-                                    tcg_gen_or_i32(tmp2, tmp2, tmp);
-                                    tcg_temp_free_i32(tmp);
-                                }
-                            }
-                            neon_store_reg(rd, pass, tmp2);
-                        } else {
-                            tmp2 = neon_load_reg(rd, pass);
-                            for (n = 0; n < 4; n++) {
-                                tmp = tcg_temp_new_i32();
-                                if (n == 0) {
-                                    tcg_gen_mov_i32(tmp, tmp2);
-                                } else {
-                                    tcg_gen_shri_i32(tmp, tmp2, n * 8);
-                                }
-                                gen_aa32_st8(s, tmp, addr, get_mem_index(s));
-                                tcg_temp_free_i32(tmp);
-                                tcg_gen_addi_i32(addr, addr, stride);
-                            }
-                            tcg_temp_free_i32(tmp2);
-                        }
+            for (n = 0; n < 8 >> size; n++) {
+                int xs;
+                for (xs = 0; xs < interleave; xs++) {
+                    int tt = rd + reg + spacing * xs;
+
+                    if (load) {
+                        gen_aa32_ld_i64(s, tmp64, addr, mmu_idx, endian | size);
+                        neon_store_element64(tt, n, size, tmp64);
+                    } else {
+                        neon_load_element64(tmp64, tt, n, size);
+                        gen_aa32_st_i64(s, tmp64, addr, mmu_idx, endian | size);
                     }
+                    tcg_gen_add_i32(addr, addr, tmp2);
                 }
             }
-            rd += spacing;
         }
         tcg_temp_free_i32(addr);
-        stride = nregs * 8;
+        tcg_temp_free_i32(tmp2);
+        tcg_temp_free_i64(tmp64);
+        stride = nregs * interleave * 8;
     } else {
         size = (insn >> 10) & 3;
         if (size == 3) {
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

For a sequence of loads or stores from a single register,
little-endian operations can be promoted to an 8-byte op.
This can reduce the number of operations by a factor of 8.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-20-richard.henderson@linaro.org
Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 10 ++++++++++
 1 file changed, 10 insertions(+)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
         if (size == 3 && (interleave | spacing) != 1) {
             return 1;
         }
+        /* For our purposes, bytes are always little-endian.  */
+        if (size == 0) {
+            endian = MO_LE;
+        }
+        /* Consecutive little-endian elements from a single register
+         * can be promoted to a larger little-endian operation.
+         */
+        if (interleave == 1 && endian == MO_LE) {
+            size = 3;
+        }
         tmp64 = tcg_temp_new_i64();
         addr = tcg_temp_new_i32();
         tmp2 = tcg_const_i32(1 << size);
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Instead of shifts and masks, use direct loads and stores from
the neon register file.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-21-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 92 +++++++++++++++++++++++-------------------
 1 file changed, 50 insertions(+), 42 deletions(-)

From: "Edgar E. Iglesias" <edgar.iglesias@xilinx.com>

Announce the availability of the various priority queues.
This fixes an issue where guest kernels would miss to
configure secondary queues due to inproper feature bits.

Signed-off-by: Edgar E. Iglesias <edgar.iglesias@xilinx.com>
Message-id: 20181017213932.19973-2-edgar.iglesias@gmail.com
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/net/cadence_gem.c | 8 +++++++-
 1 file changed, 7 insertions(+), 1 deletion(-)

diff --git a/hw/net/cadence_gem.c b/hw/net/cadence_gem.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/net/cadence_gem.c
+++ b/hw/net/cadence_gem.c
@@ -XXX,XX +XXX,XX @@ static void gem_reset(DeviceState *d)
     int i;
     CadenceGEMState *s = CADENCE_GEM(d);
     const uint8_t *a;
+    uint32_t queues_mask = 0;
 
     DB_PRINT("\n");
 
@@ -XXX,XX +XXX,XX @@ static void gem_reset(DeviceState *d)
     s->regs[GEM_DESCONF] = 0x02500111;
     s->regs[GEM_DESCONF2] = 0x2ab13fff;
     s->regs[GEM_DESCONF5] = 0x002f2045;
-    s->regs[GEM_DESCONF6] = 0x00000200;
+    s->regs[GEM_DESCONF6] = 0x0;
+
+    if (s->num_priority_queues > 1) {
+        queues_mask = MAKE_64BIT_MASK(1, s->num_priority_queues - 1);
+        s->regs[GEM_DESCONF6] |= queues_mask;
+    }
 
     /* Set MAC address */
     a = &s->conf.macaddr.a[0];
-- 
2.19.1

From: "Edgar E. Iglesias" <edgar.iglesias@xilinx.com>

Announce 64bit addressing support.

Reviewed-by: Alistair Francis <alistair.francis@wdc.com>
Signed-off-by: Edgar E. Iglesias <edgar.iglesias@xilinx.com>
Message-id: 20181017213932.19973-3-edgar.iglesias@gmail.com
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/net/cadence_gem.c | 3 ++-
 1 file changed, 2 insertions(+), 1 deletion(-)

diff --git a/hw/net/cadence_gem.c b/hw/net/cadence_gem.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/net/cadence_gem.c
+++ b/hw/net/cadence_gem.c
@@ -XXX,XX +XXX,XX @@
 #define GEM_DESCONF4      (0x0000028C/4)
 #define GEM_DESCONF5      (0x00000290/4)
 #define GEM_DESCONF6      (0x00000294/4)
+#define GEM_DESCONF6_64B_MASK (1U << 23)
 #define GEM_DESCONF7      (0x00000298/4)
 
 #define GEM_INT_Q1_STATUS               (0x00000400 / 4)
@@ -XXX,XX +XXX,XX @@ static void gem_reset(DeviceState *d)
     s->regs[GEM_DESCONF] = 0x02500111;
     s->regs[GEM_DESCONF2] = 0x2ab13fff;
     s->regs[GEM_DESCONF5] = 0x002f2045;
-    s->regs[GEM_DESCONF6] = 0x0;
+    s->regs[GEM_DESCONF6] = GEM_DESCONF6_64B_MASK;
 
     if (s->num_priority_queues > 1) {
         queues_mask = MAKE_64BIT_MASK(1, s->num_priority_queues - 1);
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

The EL3 version of this register does not include an ASID,
and so the tlb_flush performed by vmsa_ttbr_write is not needed.

Reviewed-by: Aaron Lindsay <aaron@os.amperecomputing.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20181019015617.22583-2-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper.c | 2 +-
 1 file changed, 1 insertion(+), 1 deletion(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo el3_cp_reginfo[] = {
       .fieldoffset = offsetof(CPUARMState, cp15.mvbar) },
     { .name = "TTBR0_EL3", .state = ARM_CP_STATE_AA64,
       .opc0 = 3, .opc1 = 6, .crn = 2, .crm = 0, .opc2 = 0,
-      .access = PL3_RW, .writefn = vmsa_ttbr_write, .resetvalue = 0,
+      .access = PL3_RW, .resetvalue = 0,
       .fieldoffset = offsetof(CPUARMState, cp15.ttbr0_el[3]) },
     { .name = "TCR_EL3", .state = ARM_CP_STATE_AA64,
       .opc0 = 3, .opc1 = 6, .crn = 2, .crm = 0, .opc2 = 2,
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Since QEMU does not implement ASIDs, changes to the ASID must flush the
tlb.  However, if the ASID does not change there is no reason to flush.

In testing a boot of the Ubuntu installer to the first menu, this reduces
the number of flushes by 30%, or nearly 600k instances.

Reviewed-by: Aaron Lindsay <aaron@os.amperecomputing.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Message-id: 20181019015617.22583-3-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper.c | 8 +++-----
 1 file changed, 3 insertions(+), 5 deletions(-)

This is mostly RTH's tcg_constant refactoring work, plus a few
other things.

thanks
-- PMM

The following changes since commit cf6f26d6f9b2015ee12b4604b79359e76784163a:

Merge tag 'kraxel-20220427-pull-request' of git://git.kraxel.org/qemu into staging (2022-04-27 10:49:28 -0700)

are available in the Git repository at:

https://git.linaro.org/people/pmaydell/qemu-arm.git tags/pull-target-arm-20220428

for you to fetch changes up to f8e7163d9e6740b5cef02bf73a17a59d0bef8bdb:

hw/arm/smmuv3: Advertise support for SMMUv3.2-BBML2 (2022-04-28 13:59:23 +0100)

----------------------------------------------------------------
target-arm queue:
 * refactor to use tcg_constant where appropriate
 * Advertise support for FEAT_TTL and FEAT_BBM level 2
 * smmuv3: Cache event fault record
 * smmuv3: Add space in guest error message
 * smmuv3: Advertise support for SMMUv3.2-BBML2

----------------------------------------------------------------
Damien Hedde (1):
      target/arm: Disable cryptographic instructions when neon is disabled

Jean-Philippe Brucker (2):
      hw/arm/smmuv3: Cache event fault record
      hw/arm/smmuv3: Add space in guest error message

Peter Maydell (3):
      target/arm: Advertise support for FEAT_TTL
      target/arm: Advertise support for FEAT_BBM level 2
      hw/arm/smmuv3: Advertise support for SMMUv3.2-BBML2

Richard Henderson (48):
      target/arm: Use tcg_constant in gen_probe_access
      target/arm: Use tcg_constant in gen_mte_check*
      target/arm: Use tcg_constant in gen_exception*
      target/arm: Use tcg_constant in gen_adc_CC
      target/arm: Use tcg_constant in handle_msr_i
      target/arm: Use tcg_constant in handle_sys
      target/arm: Use tcg_constant in disas_exc
      target/arm: Use tcg_constant in gen_compare_and_swap_pair
      target/arm: Use tcg_constant in disas_ld_lit
      target/arm: Use tcg_constant in disas_ldst_*
      target/arm: Use tcg_constant in disas_add_sum_imm*
      target/arm: Use tcg_constant in disas_movw_imm
      target/arm: Use tcg_constant in shift_reg_imm
      target/arm: Use tcg_constant in disas_cond_select
      target/arm: Use tcg_constant in handle_{rev16,crc32}
      target/arm: Use tcg_constant in disas_data_proc_2src
      target/arm: Use tcg_constant in disas_fp*
      target/arm: Use tcg_constant in simd shift expanders
      target/arm: Use tcg_constant in simd fp/int conversion
      target/arm: Use tcg_constant in 2misc expanders
      target/arm: Use tcg_constant in balance of translate-a64.c
      target/arm: Use tcg_constant for aa32 exceptions
      target/arm: Use tcg_constant for disas_iwmmxt_insn
      target/arm: Use tcg_constant for gen_{msr,mrs}
      target/arm: Use tcg_constant for vector shift expanders
      target/arm: Use tcg_constant for do_coproc_insn
      target/arm: Use tcg_constant for gen_srs
      target/arm: Use tcg_constant for op_s_{rri,rxi}_rot
      target/arm: Use tcg_constant for MOVW, UMAAL, CRC32
      target/arm: Use tcg_constant for v7m MRS, MSR
      target/arm: Use tcg_constant for TT, SAT, SMMLA
      target/arm: Use tcg_constant in LDM, STM
      target/arm: Use tcg_constant in CLRM, DLS, WLS, LE
      target/arm: Use tcg_constant in trans_CPS_v7m
      target/arm: Use tcg_constant in trans_CSEL
      target/arm: Use tcg_constant for trans_INDEX_*
      target/arm: Use tcg_constant in SINCDEC, INCDEC
      target/arm: Use tcg_constant in FCPY, CPY
      target/arm: Use tcg_constant in {incr, wrap}_last_active
      target/arm: Use tcg_constant in do_clast_scalar
      target/arm: Use tcg_constant in WHILE
      target/arm: Use tcg_constant in LD1, ST1
      target/arm: Use tcg_constant in SUBR
      target/arm: Use tcg_constant in do_zzi_{sat, ool}, do_fp_imm
      target/arm: Use tcg_constant for predicate descriptors
      target/arm: Use tcg_constant for do_brk{2,3}
      target/arm: Use tcg_constant for vector descriptor
      target/arm: Use field names for accessing DBGWCRn

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-2-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 12 ++++--------
 1 file changed, 4 insertions(+), 8 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void gen_address_with_allocation_tag0(TCGv_i64 dst, TCGv_i64 src)
 static void gen_probe_access(DisasContext *s, TCGv_i64 ptr,
                              MMUAccessType acc, int log2_size)
 {
-    TCGv_i32 t_acc = tcg_const_i32(acc);
-    TCGv_i32 t_idx = tcg_const_i32(get_mem_index(s));
-    TCGv_i32 t_size = tcg_const_i32(1 << log2_size);
-
-    gen_helper_probe_access(cpu_env, ptr, t_acc, t_idx, t_size);
-    tcg_temp_free_i32(t_acc);
-    tcg_temp_free_i32(t_idx);
-    tcg_temp_free_i32(t_size);
+    gen_helper_probe_access(cpu_env, ptr,
+                            tcg_constant_i32(acc),
+                            tcg_constant_i32(get_mem_index(s)),
+                            tcg_constant_i32(1 << log2_size));
 }
 
 /*
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-3-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 10 ++--------
 1 file changed, 2 insertions(+), 8 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static TCGv_i64 gen_mte_check1_mmuidx(DisasContext *s, TCGv_i64 addr,
                                       int core_idx)
 {
     if (tag_checked && s->mte_active[is_unpriv]) {
-        TCGv_i32 tcg_desc;
         TCGv_i64 ret;
         int desc = 0;
 
@@ -XXX,XX +XXX,XX @@ static TCGv_i64 gen_mte_check1_mmuidx(DisasContext *s, TCGv_i64 addr,
         desc = FIELD_DP32(desc, MTEDESC, TCMA, s->tcma);
         desc = FIELD_DP32(desc, MTEDESC, WRITE, is_write);
         desc = FIELD_DP32(desc, MTEDESC, SIZEM1, (1 << log2_size) - 1);
-        tcg_desc = tcg_const_i32(desc);
 
         ret = new_tmp_a64(s);
-        gen_helper_mte_check(ret, cpu_env, tcg_desc, addr);
-        tcg_temp_free_i32(tcg_desc);
+        gen_helper_mte_check(ret, cpu_env, tcg_constant_i32(desc), addr);
 
         return ret;
     }
@@ -XXX,XX +XXX,XX @@ TCGv_i64 gen_mte_checkN(DisasContext *s, TCGv_i64 addr, bool is_write,
                         bool tag_checked, int size)
 {
     if (tag_checked && s->mte_active[0]) {
-        TCGv_i32 tcg_desc;
         TCGv_i64 ret;
         int desc = 0;
 
@@ -XXX,XX +XXX,XX @@ TCGv_i64 gen_mte_checkN(DisasContext *s, TCGv_i64 addr, bool is_write,
         desc = FIELD_DP32(desc, MTEDESC, TCMA, s->tcma);
         desc = FIELD_DP32(desc, MTEDESC, WRITE, is_write);
         desc = FIELD_DP32(desc, MTEDESC, SIZEM1, size - 1);
-        tcg_desc = tcg_const_i32(desc);
 
         ret = new_tmp_a64(s);
-        gen_helper_mte_check(ret, cpu_env, tcg_desc, addr);
-        tcg_temp_free_i32(tcg_desc);
+        gen_helper_mte_check(ret, cpu_env, tcg_constant_i32(desc), addr);
 
         return ret;
     }
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-4-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 11 ++---------
 1 file changed, 2 insertions(+), 9 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void gen_rebuild_hflags(DisasContext *s)
 
 static void gen_exception_internal(int excp)
 {
-    TCGv_i32 tcg_excp = tcg_const_i32(excp);
-
     assert(excp_is_internal(excp));
-    gen_helper_exception_internal(cpu_env, tcg_excp);
-    tcg_temp_free_i32(tcg_excp);
+    gen_helper_exception_internal(cpu_env, tcg_constant_i32(excp));
 }
 
 static void gen_exception_internal_insn(DisasContext *s, uint64_t pc, int excp)
@@ -XXX,XX +XXX,XX @@ static void gen_exception_internal_insn(DisasContext *s, uint64_t pc, int excp)
 
 static void gen_exception_bkpt_insn(DisasContext *s, uint32_t syndrome)
 {
-    TCGv_i32 tcg_syn;
-
     gen_a64_set_pc_im(s->pc_curr);
-    tcg_syn = tcg_const_i32(syndrome);
-    gen_helper_exception_bkpt_insn(cpu_env, tcg_syn);
-    tcg_temp_free_i32(tcg_syn);
+    gen_helper_exception_bkpt_insn(cpu_env, tcg_constant_i32(syndrome));
     s->base.is_jmp = DISAS_NORETURN;
 }
 
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Note that tmp was doing double-duty as zero
and then later as a temporary in its own right.
Split the use of 0 to a new variable 'zero'.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-5-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 26 +++++++++++++-------------
 1 file changed, 13 insertions(+), 13 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void gen_adc(int sf, TCGv_i64 dest, TCGv_i64 t0, TCGv_i64 t1)
 static void gen_adc_CC(int sf, TCGv_i64 dest, TCGv_i64 t0, TCGv_i64 t1)
 {
     if (sf) {
-        TCGv_i64 result, cf_64, vf_64, tmp;
-        result = tcg_temp_new_i64();
-        cf_64 = tcg_temp_new_i64();
-        vf_64 = tcg_temp_new_i64();
-        tmp = tcg_const_i64(0);
+        TCGv_i64 result = tcg_temp_new_i64();
+        TCGv_i64 cf_64 = tcg_temp_new_i64();
+        TCGv_i64 vf_64 = tcg_temp_new_i64();
+        TCGv_i64 tmp = tcg_temp_new_i64();
+        TCGv_i64 zero = tcg_constant_i64(0);
 
         tcg_gen_extu_i32_i64(cf_64, cpu_CF);
-        tcg_gen_add2_i64(result, cf_64, t0, tmp, cf_64, tmp);
-        tcg_gen_add2_i64(result, cf_64, result, cf_64, t1, tmp);
+        tcg_gen_add2_i64(result, cf_64, t0, zero, cf_64, zero);
+        tcg_gen_add2_i64(result, cf_64, result, cf_64, t1, zero);
         tcg_gen_extrl_i64_i32(cpu_CF, cf_64);
         gen_set_NZ64(result);
 
@@ -XXX,XX +XXX,XX @@ static void gen_adc_CC(int sf, TCGv_i64 dest, TCGv_i64 t0, TCGv_i64 t1)
         tcg_temp_free_i64(cf_64);
         tcg_temp_free_i64(result);
     } else {
-        TCGv_i32 t0_32, t1_32, tmp;
-        t0_32 = tcg_temp_new_i32();
-        t1_32 = tcg_temp_new_i32();
-        tmp = tcg_const_i32(0);
+        TCGv_i32 t0_32 = tcg_temp_new_i32();
+        TCGv_i32 t1_32 = tcg_temp_new_i32();
+        TCGv_i32 tmp = tcg_temp_new_i32();
+        TCGv_i32 zero = tcg_constant_i32(0);
 
         tcg_gen_extrl_i64_i32(t0_32, t0);
         tcg_gen_extrl_i64_i32(t1_32, t1);
-        tcg_gen_add2_i32(cpu_NF, cpu_CF, t0_32, tmp, cpu_CF, tmp);
-        tcg_gen_add2_i32(cpu_NF, cpu_CF, cpu_NF, cpu_CF, t1_32, tmp);
+        tcg_gen_add2_i32(cpu_NF, cpu_CF, t0_32, zero, cpu_CF, zero);
+        tcg_gen_add2_i32(cpu_NF, cpu_CF, cpu_NF, cpu_CF, t1_32, zero);
 
         tcg_gen_mov_i32(cpu_ZF, cpu_NF);
         tcg_gen_xor_i32(cpu_VF, cpu_NF, t0_32);
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-6-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 13 +++----------
 1 file changed, 3 insertions(+), 10 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void gen_axflag(void)
 static void handle_msr_i(DisasContext *s, uint32_t insn,
                          unsigned int op1, unsigned int op2, unsigned int crm)
 {
-    TCGv_i32 t1;
     int op = op1 << 3 | op2;
 
     /* End the TB by default, chaining is ok.  */
@@ -XXX,XX +XXX,XX @@ static void handle_msr_i(DisasContext *s, uint32_t insn,
         if (s->current_el == 0) {
             goto do_unallocated;
         }
-        t1 = tcg_const_i32(crm & PSTATE_SP);
-        gen_helper_msr_i_spsel(cpu_env, t1);
-        tcg_temp_free_i32(t1);
+        gen_helper_msr_i_spsel(cpu_env, tcg_constant_i32(crm & PSTATE_SP));
         break;
 
     case 0x19: /* SSBS */
@@ -XXX,XX +XXX,XX @@ static void handle_msr_i(DisasContext *s, uint32_t insn,
         break;
 
     case 0x1e: /* DAIFSet */
-        t1 = tcg_const_i32(crm);
-        gen_helper_msr_i_daifset(cpu_env, t1);
-        tcg_temp_free_i32(t1);
+        gen_helper_msr_i_daifset(cpu_env, tcg_constant_i32(crm));
         break;
 
     case 0x1f: /* DAIFClear */
-        t1 = tcg_const_i32(crm);
-        gen_helper_msr_i_daifclear(cpu_env, t1);
-        tcg_temp_free_i32(t1);
+        gen_helper_msr_i_daifclear(cpu_env, tcg_constant_i32(crm));
         /* For DAIFClear, exit the cpu loop to re-evaluate pending IRQs.  */
         s->base.is_jmp = DISAS_UPDATE_EXIT;
         break;
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-7-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 31 +++++++++----------------------
 1 file changed, 9 insertions(+), 22 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void handle_sys(DisasContext *s, uint32_t insn, bool isread,
         /* Emit code to perform further access permissions checks at
          * runtime; this may result in an exception.
          */
-        TCGv_ptr tmpptr;
-        TCGv_i32 tcg_syn, tcg_isread;
         uint32_t syndrome;
 
-        gen_a64_set_pc_im(s->pc_curr);
-        tmpptr = tcg_const_ptr(ri);
         syndrome = syn_aa64_sysregtrap(op0, op1, op2, crn, crm, rt, isread);
-        tcg_syn = tcg_const_i32(syndrome);
-        tcg_isread = tcg_const_i32(isread);
-        gen_helper_access_check_cp_reg(cpu_env, tmpptr, tcg_syn, tcg_isread);
-        tcg_temp_free_ptr(tmpptr);
-        tcg_temp_free_i32(tcg_syn);
-        tcg_temp_free_i32(tcg_isread);
+        gen_a64_set_pc_im(s->pc_curr);
+        gen_helper_access_check_cp_reg(cpu_env,
+                                       tcg_constant_ptr(ri),
+                                       tcg_constant_i32(syndrome),
+                                       tcg_constant_i32(isread));
     } else if (ri->type & ARM_CP_RAISES_EXC) {
         /*
          * The readfn or writefn might raise an exception;
@@ -XXX,XX +XXX,XX @@ static void handle_sys(DisasContext *s, uint32_t insn, bool isread,
     case ARM_CP_DC_ZVA:
         /* Writes clear the aligned block of memory which rt points into. */
         if (s->mte_active[0]) {
-            TCGv_i32 t_desc;
             int desc = 0;
 
             desc = FIELD_DP32(desc, MTEDESC, MIDX, get_mem_index(s));
             desc = FIELD_DP32(desc, MTEDESC, TBI, s->tbid);
             desc = FIELD_DP32(desc, MTEDESC, TCMA, s->tcma);
-            t_desc = tcg_const_i32(desc);
 
             tcg_rt = new_tmp_a64(s);
-            gen_helper_mte_check_zva(tcg_rt, cpu_env, t_desc, cpu_reg(s, rt));
-            tcg_temp_free_i32(t_desc);
+            gen_helper_mte_check_zva(tcg_rt, cpu_env,
+                                     tcg_constant_i32(desc), cpu_reg(s, rt));
         } else {
             tcg_rt = clean_data_tbi(s, cpu_reg(s, rt));
         }
@@ -XXX,XX +XXX,XX @@ static void handle_sys(DisasContext *s, uint32_t insn, bool isread,
         if (ri->type & ARM_CP_CONST) {
             tcg_gen_movi_i64(tcg_rt, ri->resetvalue);
         } else if (ri->readfn) {
-            TCGv_ptr tmpptr;
-            tmpptr = tcg_const_ptr(ri);
-            gen_helper_get_cp_reg64(tcg_rt, cpu_env, tmpptr);
-            tcg_temp_free_ptr(tmpptr);
+            gen_helper_get_cp_reg64(tcg_rt, cpu_env, tcg_constant_ptr(ri));
         } else {
             tcg_gen_ld_i64(tcg_rt, cpu_env, ri->fieldoffset);
         }
@@ -XXX,XX +XXX,XX @@ static void handle_sys(DisasContext *s, uint32_t insn, bool isread,
             /* If not forbidden by access permissions, treat as WI */
             return;
         } else if (ri->writefn) {
-            TCGv_ptr tmpptr;
-            tmpptr = tcg_const_ptr(ri);
-            gen_helper_set_cp_reg64(cpu_env, tmpptr, tcg_rt);
-            tcg_temp_free_ptr(tmpptr);
+            gen_helper_set_cp_reg64(cpu_env, tcg_constant_ptr(ri), tcg_rt);
         } else {
             tcg_gen_st_i64(tcg_rt, cpu_env, ri->fieldoffset);
         }
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-8-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 5 +----
 1 file changed, 1 insertion(+), 4 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_exc(DisasContext *s, uint32_t insn)
     int opc = extract32(insn, 21, 3);
     int op2_ll = extract32(insn, 0, 5);
     int imm16 = extract32(insn, 5, 16);
-    TCGv_i32 tmp;
 
     switch (opc) {
     case 0:
@@ -XXX,XX +XXX,XX @@ static void disas_exc(DisasContext *s, uint32_t insn)
                 break;
             }
             gen_a64_set_pc_im(s->pc_curr);
-            tmp = tcg_const_i32(syn_aa64_smc(imm16));
-            gen_helper_pre_smc(cpu_env, tmp);
-            tcg_temp_free_i32(tmp);
+            gen_helper_pre_smc(cpu_env, tcg_constant_i32(syn_aa64_smc(imm16)));
             gen_ss_advance(s);
             gen_exception_insn(s, s->base.pc_next, EXCP_SMC,
                                syn_aa64_smc(imm16), 3);
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-9-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 6 ++----
 1 file changed, 2 insertions(+), 4 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void gen_compare_and_swap_pair(DisasContext *s, int rs, int rt,
         tcg_temp_free_i64(cmp);
     } else if (tb_cflags(s->base.tb) & CF_PARALLEL) {
         if (HAVE_CMPXCHG128) {
-            TCGv_i32 tcg_rs = tcg_const_i32(rs);
+            TCGv_i32 tcg_rs = tcg_constant_i32(rs);
             if (s->be_data == MO_LE) {
                 gen_helper_casp_le_parallel(cpu_env, tcg_rs,
                                             clean_addr, t1, t2);
@@ -XXX,XX +XXX,XX @@ static void gen_compare_and_swap_pair(DisasContext *s, int rs, int rt,
                 gen_helper_casp_be_parallel(cpu_env, tcg_rs,
                                             clean_addr, t1, t2);
             }
-            tcg_temp_free_i32(tcg_rs);
         } else {
             gen_helper_exit_atomic(cpu_env);
             s->base.is_jmp = DISAS_NORETURN;
@@ -XXX,XX +XXX,XX @@ static void gen_compare_and_swap_pair(DisasContext *s, int rs, int rt,
         TCGv_i64 a2 = tcg_temp_new_i64();
         TCGv_i64 c1 = tcg_temp_new_i64();
         TCGv_i64 c2 = tcg_temp_new_i64();
-        TCGv_i64 zero = tcg_const_i64(0);
+        TCGv_i64 zero = tcg_constant_i64(0);
 
         /* Load the two words, in memory order.  */
         tcg_gen_qemu_ld_i64(d1, clean_addr, memidx,
@@ -XXX,XX +XXX,XX @@ static void gen_compare_and_swap_pair(DisasContext *s, int rs, int rt,
         tcg_temp_free_i64(a2);
         tcg_temp_free_i64(c1);
         tcg_temp_free_i64(c2);
-        tcg_temp_free_i64(zero);
 
         /* Write back the data from memory to Rs.  */
         tcg_gen_mov_i64(s1, d1);
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-10-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 3 +--
 1 file changed, 1 insertion(+), 2 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_ld_lit(DisasContext *s, uint32_t insn)
 
     tcg_rt = cpu_reg(s, rt);
 
-    clean_addr = tcg_const_i64(s->pc_curr + imm);
+    clean_addr = tcg_constant_i64(s->pc_curr + imm);
     if (is_vector) {
         do_fp_ld(s, rt, clean_addr, size);
     } else {
@@ -XXX,XX +XXX,XX @@ static void disas_ld_lit(DisasContext *s, uint32_t insn)
         do_gpr_ld(s, tcg_rt, clean_addr, size + is_signed * MO_SIGN,
                   false, true, rt, iss_sf, false);
     }
-    tcg_temp_free_i64(clean_addr);
 }
 
 /*
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-11-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 9 +++------
 1 file changed, 3 insertions(+), 6 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
     mop = endian | size | align;
 
     elements = (is_q ? 16 : 8) >> size;
-    tcg_ebytes = tcg_const_i64(1 << size);
+    tcg_ebytes = tcg_constant_i64(1 << size);
     for (r = 0; r < rpt; r++) {
         int e;
         for (e = 0; e < elements; e++) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
             }
         }
     }
-    tcg_temp_free_i64(tcg_ebytes);
 
     if (!is_store) {
         /* For non-quad operations, setting a slice of the low
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
                                 total);
     mop = finalize_memop(s, scale);
 
-    tcg_ebytes = tcg_const_i64(1 << scale);
+    tcg_ebytes = tcg_constant_i64(1 << scale);
     for (xs = 0; xs < selem; xs++) {
         if (replicate) {
             /* Load and replicate to all elements */
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
         tcg_gen_add_i64(clean_addr, clean_addr, tcg_ebytes);
         rt = (rt + 1) % 32;
     }
-    tcg_temp_free_i64(tcg_ebytes);
 
     if (is_postidx) {
         if (rm == 31) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_tag(DisasContext *s, uint32_t insn)
 
     if (is_zero) {
         TCGv_i64 clean_addr = clean_data_tbi(s, addr);
-        TCGv_i64 tcg_zero = tcg_const_i64(0);
+        TCGv_i64 tcg_zero = tcg_constant_i64(0);
         int mem_index = get_mem_index(s);
         int i, n = (1 + is_pair) << LOG2_TAG_GRANULE;
 
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_tag(DisasContext *s, uint32_t insn)
             tcg_gen_addi_i64(clean_addr, clean_addr, 8);
             tcg_gen_qemu_st_i64(tcg_zero, clean_addr, mem_index, MO_UQ);
         }
-        tcg_temp_free_i64(tcg_zero);
     }
 
     if (index != 0) {
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-12-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 12 ++++--------
 1 file changed, 4 insertions(+), 8 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_add_sub_imm(DisasContext *s, uint32_t insn)
             tcg_gen_addi_i64(tcg_result, tcg_rn, imm);
         }
     } else {
-        TCGv_i64 tcg_imm = tcg_const_i64(imm);
+        TCGv_i64 tcg_imm = tcg_constant_i64(imm);
         if (sub_op) {
             gen_sub_CC(is_64bit, tcg_result, tcg_rn, tcg_imm);
         } else {
             gen_add_CC(is_64bit, tcg_result, tcg_rn, tcg_imm);
         }
-        tcg_temp_free_i64(tcg_imm);
     }
 
     if (is_64bit) {
@@ -XXX,XX +XXX,XX @@ static void disas_add_sub_imm_with_tags(DisasContext *s, uint32_t insn)
     tcg_rd = cpu_reg_sp(s, rd);
 
     if (s->ata) {
-        TCGv_i32 offset = tcg_const_i32(imm);
-        TCGv_i32 tag_offset = tcg_const_i32(uimm4);
-
-        gen_helper_addsubg(tcg_rd, cpu_env, tcg_rn, offset, tag_offset);
-        tcg_temp_free_i32(tag_offset);
-        tcg_temp_free_i32(offset);
+        gen_helper_addsubg(tcg_rd, cpu_env, tcg_rn,
+                           tcg_constant_i32(imm),
+                           tcg_constant_i32(uimm4));
     } else {
         tcg_gen_addi_i64(tcg_rd, tcg_rn, imm);
         gen_address_with_allocation_tag0(tcg_rd, tcg_rd);
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-13-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 5 +----
 1 file changed, 1 insertion(+), 4 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_movw_imm(DisasContext *s, uint32_t insn)
     int opc = extract32(insn, 29, 2);
     int pos = extract32(insn, 21, 2) << 4;
     TCGv_i64 tcg_rd = cpu_reg(s, rd);
-    TCGv_i64 tcg_imm;
 
     if (!sf && (pos >= 32)) {
         unallocated_encoding(s);
@@ -XXX,XX +XXX,XX @@ static void disas_movw_imm(DisasContext *s, uint32_t insn)
         tcg_gen_movi_i64(tcg_rd, imm);
         break;
     case 3: /* MOVK */
-        tcg_imm = tcg_const_i64(imm);
-        tcg_gen_deposit_i64(tcg_rd, tcg_rd, tcg_imm, pos, 16);
-        tcg_temp_free_i64(tcg_imm);
+        tcg_gen_deposit_i64(tcg_rd, tcg_rd, tcg_constant_i64(imm), pos, 16);
         if (!sf) {
             tcg_gen_ext32u_i64(tcg_rd, tcg_rd);
         }
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-15-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 3 +--
 1 file changed, 1 insertion(+), 2 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_cond_select(DisasContext *s, uint32_t insn)
     tcg_rd = cpu_reg(s, rd);
 
     a64_test_cc(&c, cond);
-    zero = tcg_const_i64(0);
+    zero = tcg_constant_i64(0);
 
     if (rn == 31 && rm == 31 && (else_inc ^ else_inv)) {
         /* CSET & CSETM.  */
@@ -XXX,XX +XXX,XX @@ static void disas_cond_select(DisasContext *s, uint32_t insn)
         tcg_gen_movcond_i64(c.cond, tcg_rd, c.value, zero, t_true, t_false);
     }
 
-    tcg_temp_free_i64(zero);
     a64_free_cc(&c);
 
     if (!sf) {
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-16-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 7 ++-----
 1 file changed, 2 insertions(+), 5 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void handle_rev16(DisasContext *s, unsigned int sf,
     TCGv_i64 tcg_rd = cpu_reg(s, rd);
     TCGv_i64 tcg_tmp = tcg_temp_new_i64();
     TCGv_i64 tcg_rn = read_cpu_reg(s, rn, sf);
-    TCGv_i64 mask = tcg_const_i64(sf ? 0x00ff00ff00ff00ffull : 0x00ff00ff);
+    TCGv_i64 mask = tcg_constant_i64(sf ? 0x00ff00ff00ff00ffull : 0x00ff00ff);
 
     tcg_gen_shri_i64(tcg_tmp, tcg_rn, 8);
     tcg_gen_and_i64(tcg_rd, tcg_rn, mask);
@@ -XXX,XX +XXX,XX @@ static void handle_rev16(DisasContext *s, unsigned int sf,
     tcg_gen_shli_i64(tcg_rd, tcg_rd, 8);
     tcg_gen_or_i64(tcg_rd, tcg_rd, tcg_tmp);
 
-    tcg_temp_free_i64(mask);
     tcg_temp_free_i64(tcg_tmp);
 }
 
@@ -XXX,XX +XXX,XX @@ static void handle_crc32(DisasContext *s,
     }
 
     tcg_acc = cpu_reg(s, rn);
-    tcg_bytes = tcg_const_i32(1 << sz);
+    tcg_bytes = tcg_constant_i32(1 << sz);
 
     if (crc32c) {
         gen_helper_crc32c_64(cpu_reg(s, rd), tcg_acc, tcg_val, tcg_bytes);
     } else {
         gen_helper_crc32_64(cpu_reg(s, rd), tcg_acc, tcg_val, tcg_bytes);
     }
-
-    tcg_temp_free_i32(tcg_bytes);
 }
 
 /* Data-processing (2 source)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Existing temp usage treats t1 as both zero and as a
temporary.  Rearrange to only require one temporary,
so remove t1 and rename t2.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-17-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 12 +++++-------
 1 file changed, 5 insertions(+), 7 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_data_proc_2src(DisasContext *s, uint32_t insn)
         if (sf == 0 || !dc_isar_feature(aa64_mte_insn_reg, s)) {
             goto do_unallocated;
         } else {
-            TCGv_i64 t1 = tcg_const_i64(1);
-            TCGv_i64 t2 = tcg_temp_new_i64();
+            TCGv_i64 t = tcg_temp_new_i64();
 
-            tcg_gen_extract_i64(t2, cpu_reg_sp(s, rn), 56, 4);
-            tcg_gen_shl_i64(t1, t1, t2);
-            tcg_gen_or_i64(cpu_reg(s, rd), cpu_reg(s, rm), t1);
+            tcg_gen_extract_i64(t, cpu_reg_sp(s, rn), 56, 4);
+            tcg_gen_shl_i64(t, tcg_constant_i64(1), t);
+            tcg_gen_or_i64(cpu_reg(s, rd), cpu_reg(s, rm), t);
 
-            tcg_temp_free_i64(t1);
-            tcg_temp_free_i64(t2);
+            tcg_temp_free_i64(t);
         }
         break;
     case 8: /* LSLV */
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-18-richard.henderson@linaro.org
[PMM: Restore incorrectly removed free of t_false in disas_fp_csel()]
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 23 +++++++----------------
 1 file changed, 7 insertions(+), 16 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void handle_fp_compare(DisasContext *s, int size,
 
         tcg_vn = read_fp_dreg(s, rn);
         if (cmp_with_zero) {
-            tcg_vm = tcg_const_i64(0);
+            tcg_vm = tcg_constant_i64(0);
         } else {
             tcg_vm = read_fp_dreg(s, rm);
         }
@@ -XXX,XX +XXX,XX @@ static void disas_fp_compare(DisasContext *s, uint32_t insn)
 static void disas_fp_ccomp(DisasContext *s, uint32_t insn)
 {
     unsigned int mos, type, rm, cond, rn, op, nzcv;
-    TCGv_i64 tcg_flags;
     TCGLabel *label_continue = NULL;
     int size;
 
@@ -XXX,XX +XXX,XX @@ static void disas_fp_ccomp(DisasContext *s, uint32_t insn)
         label_continue = gen_new_label();
         arm_gen_test_cc(cond, label_match);
         /* nomatch: */
-        tcg_flags = tcg_const_i64(nzcv << 28);
-        gen_set_nzcv(tcg_flags);
-        tcg_temp_free_i64(tcg_flags);
+        gen_set_nzcv(tcg_constant_i64(nzcv << 28));
         tcg_gen_br(label_continue);
         gen_set_label(label_match);
     }
@@ -XXX,XX +XXX,XX @@ static void disas_fp_ccomp(DisasContext *s, uint32_t insn)
 static void disas_fp_csel(DisasContext *s, uint32_t insn)
 {
     unsigned int mos, type, rm, cond, rn, rd;
-    TCGv_i64 t_true, t_false, t_zero;
+    TCGv_i64 t_true, t_false;
     DisasCompare64 c;
     MemOp sz;
 
@@ -XXX,XX +XXX,XX @@ static void disas_fp_csel(DisasContext *s, uint32_t insn)
     read_vec_element(s, t_false, rm, 0, sz);
 
     a64_test_cc(&c, cond);
-    t_zero = tcg_const_i64(0);
-    tcg_gen_movcond_i64(c.cond, t_true, c.value, t_zero, t_true, t_false);
-    tcg_temp_free_i64(t_zero);
+    tcg_gen_movcond_i64(c.cond, t_true, c.value, tcg_constant_i64(0),
+                        t_true, t_false);
     tcg_temp_free_i64(t_false);
     a64_free_cc(&c);
 
@@ -XXX,XX +XXX,XX @@ static void disas_fp_imm(DisasContext *s, uint32_t insn)
     int type = extract32(insn, 22, 2);
     int mos = extract32(insn, 29, 3);
     uint64_t imm;
-    TCGv_i64 tcg_res;
     MemOp sz;
 
     if (mos || imm5) {
@@ -XXX,XX +XXX,XX @@ static void disas_fp_imm(DisasContext *s, uint32_t insn)
     }
 
     imm = vfp_expand_imm(sz, imm8);
-
-    tcg_res = tcg_const_i64(imm);
-    write_fp_dreg(s, rd, tcg_res);
-    tcg_temp_free_i64(tcg_res);
+    write_fp_dreg(s, rd, tcg_constant_i64(imm));
 }
 
 /* Handle floating point <=> fixed point conversions. Note that we can
@@ -XXX,XX +XXX,XX @@ static void handle_fpfpcvt(DisasContext *s, int rd, int rn, int opcode,
 
     tcg_fpstatus = fpstatus_ptr(type == 3 ? FPST_FPCR_F16 : FPST_FPCR);
 
-    tcg_shift = tcg_const_i32(64 - scale);
+    tcg_shift = tcg_constant_i32(64 - scale);
 
     if (itof) {
         TCGv_i64 tcg_int = cpu_reg(s, rn);
@@ -XXX,XX +XXX,XX @@ static void handle_fpfpcvt(DisasContext *s, int rd, int rn, int opcode,
     }
 
     tcg_temp_free_ptr(tcg_fpstatus);
-    tcg_temp_free_i32(tcg_shift);
 }
 
 /* Floating point <-> fixed point conversions
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-19-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 21 +++++----------------
 1 file changed, 5 insertions(+), 16 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void handle_shri_with_rndacc(TCGv_i64 tcg_res, TCGv_i64 tcg_src,
     /* Deal with the rounding step */
     if (round) {
         if (extended_result) {
-            TCGv_i64 tcg_zero = tcg_const_i64(0);
+            TCGv_i64 tcg_zero = tcg_constant_i64(0);
             if (!is_u) {
                 /* take care of sign extending tcg_res */
                 tcg_gen_sari_i64(tcg_src_hi, tcg_src, 63);
@@ -XXX,XX +XXX,XX @@ static void handle_shri_with_rndacc(TCGv_i64 tcg_res, TCGv_i64 tcg_src,
                                  tcg_src, tcg_zero,
                                  tcg_rnd, tcg_zero);
             }
-            tcg_temp_free_i64(tcg_zero);
         } else {
             tcg_gen_add_i64(tcg_src, tcg_src, tcg_rnd);
         }
@@ -XXX,XX +XXX,XX @@ static void handle_scalar_simd_shri(DisasContext *s,
     }
 
     if (round) {
-        uint64_t round_const = 1ULL << (shift - 1);
-        tcg_round = tcg_const_i64(round_const);
+        tcg_round = tcg_constant_i64(1ULL << (shift - 1));
     } else {
         tcg_round = NULL;
     }
@@ -XXX,XX +XXX,XX @@ static void handle_scalar_simd_shri(DisasContext *s,
 
     tcg_temp_free_i64(tcg_rn);
     tcg_temp_free_i64(tcg_rd);
-    if (round) {
-        tcg_temp_free_i64(tcg_round);
-    }
 }
 
 /* SHL/SLI - Scalar shift left */
@@ -XXX,XX +XXX,XX @@ static void handle_vec_simd_sqshrn(DisasContext *s, bool is_scalar, bool is_q,
     tcg_final = tcg_const_i64(0);
 
     if (round) {
-        uint64_t round_const = 1ULL << (shift - 1);
-        tcg_round = tcg_const_i64(round_const);
+        tcg_round = tcg_constant_i64(1ULL << (shift - 1));
     } else {
         tcg_round = NULL;
     }
@@ -XXX,XX +XXX,XX @@ static void handle_vec_simd_sqshrn(DisasContext *s, bool is_scalar, bool is_q,
         write_vec_element(s, tcg_final, rd, 1, MO_64);
     }
 
-    if (round) {
-        tcg_temp_free_i64(tcg_round);
-    }
     tcg_temp_free_i64(tcg_rn);
     tcg_temp_free_i64(tcg_rd);
     tcg_temp_free_i32(tcg_rd_narrowed);
@@ -XXX,XX +XXX,XX @@ static void handle_simd_qshl(DisasContext *s, bool scalar, bool is_q,
     }
 
     if (size == 3) {
-        TCGv_i64 tcg_shift = tcg_const_i64(shift);
+        TCGv_i64 tcg_shift = tcg_constant_i64(shift);
         static NeonGenTwo64OpEnvFn * const fns[2][2] = {
             { gen_helper_neon_qshl_s64, gen_helper_neon_qshlu_s64 },
             { NULL, gen_helper_neon_qshl_u64 },
@@ -XXX,XX +XXX,XX @@ static void handle_simd_qshl(DisasContext *s, bool scalar, bool is_q,
 
             tcg_temp_free_i64(tcg_op);
         }
-        tcg_temp_free_i64(tcg_shift);
         clear_vec_high(s, is_q, rd);
     } else {
-        TCGv_i32 tcg_shift = tcg_const_i32(shift);
+        TCGv_i32 tcg_shift = tcg_constant_i32(shift);
         static NeonGenTwoOpEnvFn * const fns[2][2][3] = {
             {
                 { gen_helper_neon_qshl_s8,
@@ -XXX,XX +XXX,XX @@ static void handle_simd_qshl(DisasContext *s, bool scalar, bool is_q,
 
             tcg_temp_free_i32(tcg_op);
         }
-        tcg_temp_free_i32(tcg_shift);
 
         if (!scalar) {
             clear_vec_high(s, is_q, rd);
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-20-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 26 ++++++--------------------
 1 file changed, 6 insertions(+), 20 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void handle_simd_intfp_conv(DisasContext *s, int rd, int rn,
     int pass;
 
     if (fracbits || size == MO_64) {
-        tcg_shift = tcg_const_i32(fracbits);
+        tcg_shift = tcg_constant_i32(fracbits);
     }
 
     if (size == MO_64) {
@@ -XXX,XX +XXX,XX @@ static void handle_simd_intfp_conv(DisasContext *s, int rd, int rn,
     }
 
     tcg_temp_free_ptr(tcg_fpst);
-    if (tcg_shift) {
-        tcg_temp_free_i32(tcg_shift);
-    }
 
     clear_vec_high(s, elements << size == 16, rd);
 }
@@ -XXX,XX +XXX,XX @@ static void handle_simd_shift_fpint_conv(DisasContext *s, bool is_scalar,
     tcg_fpstatus = fpstatus_ptr(size == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
     gen_helper_set_rmode(tcg_rmode, tcg_rmode, tcg_fpstatus);
     fracbits = (16 << size) - immhb;
-    tcg_shift = tcg_const_i32(fracbits);
+    tcg_shift = tcg_constant_i32(fracbits);
 
     if (size == MO_64) {
         int maxpass = is_scalar ? 1 : 2;
@@ -XXX,XX +XXX,XX @@ static void handle_simd_shift_fpint_conv(DisasContext *s, bool is_scalar,
         }
     }
 
-    tcg_temp_free_i32(tcg_shift);
     gen_helper_set_rmode(tcg_rmode, tcg_rmode, tcg_fpstatus);
     tcg_temp_free_ptr(tcg_fpstatus);
     tcg_temp_free_i32(tcg_rmode);
@@ -XXX,XX +XXX,XX @@ static void handle_2misc_64(DisasContext *s, int opcode, bool u,
     case 0x1c: /* FCVTAS */
     case 0x3a: /* FCVTPS */
     case 0x3b: /* FCVTZS */
-    {
-        TCGv_i32 tcg_shift = tcg_const_i32(0);
-        gen_helper_vfp_tosqd(tcg_rd, tcg_rn, tcg_shift, tcg_fpstatus);
-        tcg_temp_free_i32(tcg_shift);
+        gen_helper_vfp_tosqd(tcg_rd, tcg_rn, tcg_constant_i32(0), tcg_fpstatus);
         break;
-    }
     case 0x5a: /* FCVTNU */
     case 0x5b: /* FCVTMU */
     case 0x5c: /* FCVTAU */
     case 0x7a: /* FCVTPU */
     case 0x7b: /* FCVTZU */
-    {
-        TCGv_i32 tcg_shift = tcg_const_i32(0);
-        gen_helper_vfp_touqd(tcg_rd, tcg_rn, tcg_shift, tcg_fpstatus);
-        tcg_temp_free_i32(tcg_shift);
+        gen_helper_vfp_touqd(tcg_rd, tcg_rn, tcg_constant_i32(0), tcg_fpstatus);
         break;
-    }
     case 0x18: /* FRINTN */
     case 0x19: /* FRINTM */
     case 0x38: /* FRINTP */
@@ -XXX,XX +XXX,XX @@ static void handle_2misc_fcmp_zero(DisasContext *s, int opcode,
 
     if (is_double) {
         TCGv_i64 tcg_op = tcg_temp_new_i64();
-        TCGv_i64 tcg_zero = tcg_const_i64(0);
+        TCGv_i64 tcg_zero = tcg_constant_i64(0);
         TCGv_i64 tcg_res = tcg_temp_new_i64();
         NeonGenTwoDoubleOpFn *genfn;
         bool swap = false;
@@ -XXX,XX +XXX,XX @@ static void handle_2misc_fcmp_zero(DisasContext *s, int opcode,
             write_vec_element(s, tcg_res, rd, pass, MO_64);
         }
         tcg_temp_free_i64(tcg_res);
-        tcg_temp_free_i64(tcg_zero);
         tcg_temp_free_i64(tcg_op);
 
         clear_vec_high(s, !is_scalar, rd);
     } else {
         TCGv_i32 tcg_op = tcg_temp_new_i32();
-        TCGv_i32 tcg_zero = tcg_const_i32(0);
+        TCGv_i32 tcg_zero = tcg_constant_i32(0);
         TCGv_i32 tcg_res = tcg_temp_new_i32();
         NeonGenTwoSingleOpFn *genfn;
         bool swap = false;
@@ -XXX,XX +XXX,XX @@ static void handle_2misc_fcmp_zero(DisasContext *s, int opcode,
             }
         }
         tcg_temp_free_i32(tcg_res);
-        tcg_temp_free_i32(tcg_zero);
         tcg_temp_free_i32(tcg_op);
         if (!is_scalar) {
             clear_vec_high(s, is_q, rd);
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-21-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 40 ++++++++++----------------------------
 1 file changed, 10 insertions(+), 30 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void handle_2misc_narrow(DisasContext *s, bool scalar,
     int passes = scalar ? 1 : 2;
 
     if (scalar) {
-        tcg_res[1] = tcg_const_i32(0);
+        tcg_res[1] = tcg_constant_i32(0);
     }
 
     for (pass = 0; pass < passes; pass++) {
@@ -XXX,XX +XXX,XX @@ static void handle_2misc_satacc(DisasContext *s, bool is_scalar, bool is_u,
             }
 
             if (is_scalar) {
-                TCGv_i64 tcg_zero = tcg_const_i64(0);
-                write_vec_element(s, tcg_zero, rd, 0, MO_64);
-                tcg_temp_free_i64(tcg_zero);
+                write_vec_element(s, tcg_constant_i64(0), rd, 0, MO_64);
             }
             write_vec_element_i32(s, tcg_rd, rd, pass, MO_32);
         }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_two_reg_misc(DisasContext *s, uint32_t insn)
         case 0x1c: /* FCVTAS */
         case 0x3a: /* FCVTPS */
         case 0x3b: /* FCVTZS */
-        {
-            TCGv_i32 tcg_shift = tcg_const_i32(0);
-            gen_helper_vfp_tosls(tcg_rd, tcg_rn, tcg_shift, tcg_fpstatus);
-            tcg_temp_free_i32(tcg_shift);
+            gen_helper_vfp_tosls(tcg_rd, tcg_rn, tcg_constant_i32(0),
+                                 tcg_fpstatus);
             break;
-        }
         case 0x5a: /* FCVTNU */
         case 0x5b: /* FCVTMU */
         case 0x5c: /* FCVTAU */
         case 0x7a: /* FCVTPU */
         case 0x7b: /* FCVTZU */
-        {
-            TCGv_i32 tcg_shift = tcg_const_i32(0);
-            gen_helper_vfp_touls(tcg_rd, tcg_rn, tcg_shift, tcg_fpstatus);
-            tcg_temp_free_i32(tcg_shift);
+            gen_helper_vfp_touls(tcg_rd, tcg_rn, tcg_constant_i32(0),
+                                 tcg_fpstatus);
             break;
-        }
         default:
             g_assert_not_reached();
         }
@@ -XXX,XX +XXX,XX @@ static void handle_vec_simd_shrn(DisasContext *s, bool is_q,
     read_vec_element(s, tcg_final, rd, is_q ? 1 : 0, MO_64);
 
     if (round) {
-        uint64_t round_const = 1ULL << (shift - 1);
-        tcg_round = tcg_const_i64(round_const);
+        tcg_round = tcg_constant_i64(1ULL << (shift - 1));
     } else {
         tcg_round = NULL;
     }
@@ -XXX,XX +XXX,XX @@ static void handle_vec_simd_shrn(DisasContext *s, bool is_q,
     } else {
         write_vec_element(s, tcg_final, rd, 1, MO_64);
     }
-    if (round) {
-        tcg_temp_free_i64(tcg_round);
-    }
     tcg_temp_free_i64(tcg_rn);
     tcg_temp_free_i64(tcg_rd);
     tcg_temp_free_i64(tcg_final);
@@ -XXX,XX +XXX,XX @@ static void handle_2misc_pairwise(DisasContext *s, int opcode, bool u,
         }
     }
     if (!is_q) {
-        tcg_res[1] = tcg_const_i64(0);
+        tcg_res[1] = tcg_constant_i64(0);
     }
     for (pass = 0; pass < 2; pass++) {
         write_vec_element(s, tcg_res[pass], rd, pass, MO_64);
@@ -XXX,XX +XXX,XX @@ static void disas_simd_two_reg_misc(DisasContext *s, uint32_t insn)
                 case 0x1c: /* FCVTAS */
                 case 0x3a: /* FCVTPS */
                 case 0x3b: /* FCVTZS */
-                {
-                    TCGv_i32 tcg_shift = tcg_const_i32(0);
                     gen_helper_vfp_tosls(tcg_res, tcg_op,
-                                         tcg_shift, tcg_fpstatus);
-                    tcg_temp_free_i32(tcg_shift);
+                                         tcg_constant_i32(0), tcg_fpstatus);
                     break;
-                }
                 case 0x5a: /* FCVTNU */
                 case 0x5b: /* FCVTMU */
                 case 0x5c: /* FCVTAU */
                 case 0x7a: /* FCVTPU */
                 case 0x7b: /* FCVTZU */
-                {
-                    TCGv_i32 tcg_shift = tcg_const_i32(0);
                     gen_helper_vfp_touls(tcg_res, tcg_op,
-                                         tcg_shift, tcg_fpstatus);
-                    tcg_temp_free_i32(tcg_shift);
+                                         tcg_constant_i32(0), tcg_fpstatus);
                     break;
-                }
                 case 0x18: /* FRINTN */
                 case 0x19: /* FRINTM */
                 case 0x38: /* FRINTP */
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Finish conversion of the file to tcg_constant_*.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-22-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 20 ++++++++------------
 1 file changed, 8 insertions(+), 12 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
         }
 
         if (is_scalar) {
-            tcg_res[1] = tcg_const_i64(0);
+            tcg_res[1] = tcg_constant_i64(0);
         }
 
         for (pass = 0; pass < 2; pass++) {
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_four_reg(DisasContext *s, uint32_t insn)
         tcg_op2 = tcg_temp_new_i32();
         tcg_op3 = tcg_temp_new_i32();
         tcg_res = tcg_temp_new_i32();
-        tcg_zero = tcg_const_i32(0);
+        tcg_zero = tcg_constant_i32(0);
 
         read_vec_element_i32(s, tcg_op1, rn, 3, MO_32);
         read_vec_element_i32(s, tcg_op2, rm, 3, MO_32);
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_four_reg(DisasContext *s, uint32_t insn)
         tcg_temp_free_i32(tcg_op2);
         tcg_temp_free_i32(tcg_op3);
         tcg_temp_free_i32(tcg_res);
-        tcg_temp_free_i32(tcg_zero);
     }
 }
 
@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_tb_stop(DisasContextBase *dcbase, CPUState *cpu)
             gen_helper_yield(cpu_env);
             break;
         case DISAS_WFI:
-        {
-            /* This is a special case because we don't want to just halt the CPU
-             * if trying to debug across a WFI.
+            /*
+             * This is a special case because we don't want to just halt
+             * the CPU if trying to debug across a WFI.
              */
-            TCGv_i32 tmp = tcg_const_i32(4);
-
             gen_a64_set_pc_im(dc->base.pc_next);
-            gen_helper_wfi(cpu_env, tmp);
-            tcg_temp_free_i32(tmp);
-            /* The helper doesn't necessarily throw an exception, but we
+            gen_helper_wfi(cpu_env, tcg_constant_i32(4));
+            /*
+             * The helper doesn't necessarily throw an exception, but we
              * must go back to the main loop to check for interrupts anyway.
              */
             tcg_gen_exit_tb(NULL, 0);
             break;
         }
-        }
     }
 }
 
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-23-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 32 +++++++-------------------------
 1 file changed, 7 insertions(+), 25 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void store_sp_checked(DisasContext *s, TCGv_i32 var)
 
 void gen_set_cpsr(TCGv_i32 var, uint32_t mask)
 {
-    TCGv_i32 tmp_mask = tcg_const_i32(mask);
-    gen_helper_cpsr_write(cpu_env, var, tmp_mask);
-    tcg_temp_free_i32(tmp_mask);
+    gen_helper_cpsr_write(cpu_env, var, tcg_constant_i32(mask));
 }
 
 static void gen_rebuild_hflags(DisasContext *s, bool new_el)
@@ -XXX,XX +XXX,XX @@ static void gen_rebuild_hflags(DisasContext *s, bool new_el)
 
 static void gen_exception_internal(int excp)
 {
-    TCGv_i32 tcg_excp = tcg_const_i32(excp);
-
     assert(excp_is_internal(excp));
-    gen_helper_exception_internal(cpu_env, tcg_excp);
-    tcg_temp_free_i32(tcg_excp);
+    gen_helper_exception_internal(cpu_env, tcg_constant_i32(excp));
 }
 
 static void gen_singlestep_exception(DisasContext *s)
@@ -XXX,XX +XXX,XX @@ static inline void gen_smc(DisasContext *s)
     /* As with HVC, we may take an exception either before or after
      * the insn executes.
      */
-    TCGv_i32 tmp;
-
     gen_set_pc_im(s, s->pc_curr);
-    tmp = tcg_const_i32(syn_aa32_smc());
-    gen_helper_pre_smc(cpu_env, tmp);
-    tcg_temp_free_i32(tmp);
+    gen_helper_pre_smc(cpu_env, tcg_constant_i32(syn_aa32_smc()));
     gen_set_pc_im(s, s->base.pc_next);
     s->base.is_jmp = DISAS_SMC;
 }
@@ -XXX,XX +XXX,XX @@ void gen_exception_insn(DisasContext *s, uint64_t pc, int excp,
 
 static void gen_exception_bkpt_insn(DisasContext *s, uint32_t syn)
 {
-    TCGv_i32 tcg_syn;
-
     gen_set_condexec(s);
     gen_set_pc_im(s, s->pc_curr);
-    tcg_syn = tcg_const_i32(syn);
-    gen_helper_exception_bkpt_insn(cpu_env, tcg_syn);
-    tcg_temp_free_i32(tcg_syn);
+    gen_helper_exception_bkpt_insn(cpu_env, tcg_constant_i32(syn));
     s->base.is_jmp = DISAS_NORETURN;
 }
 
@@ -XXX,XX +XXX,XX @@ void unallocated_encoding(DisasContext *s)
 static void gen_exception_el(DisasContext *s, int excp, uint32_t syn,
                              TCGv_i32 tcg_el)
 {
-    TCGv_i32 tcg_excp;
-    TCGv_i32 tcg_syn;
-
     gen_set_condexec(s);
     gen_set_pc_im(s, s->pc_curr);
-    tcg_excp = tcg_const_i32(excp);
-    tcg_syn = tcg_const_i32(syn);
-    gen_helper_exception_with_syndrome(cpu_env, tcg_excp, tcg_syn, tcg_el);
-    tcg_temp_free_i32(tcg_syn);
-    tcg_temp_free_i32(tcg_excp);
+    gen_helper_exception_with_syndrome(cpu_env,
+                                       tcg_constant_i32(excp),
+                                       tcg_constant_i32(syn), tcg_el);
     s->base.is_jmp = DISAS_NORETURN;
 }
 
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-24-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 25 ++++++++++---------------
 1 file changed, 10 insertions(+), 15 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_iwmmxt_insn(DisasContext *s, uint32_t insn)
         gen_op_iwmmxt_movq_M0_wRn(wrd);
         switch ((insn >> 6) & 3) {
         case 0:
-            tmp2 = tcg_const_i32(0xff);
-            tmp3 = tcg_const_i32((insn & 7) << 3);
+            tmp2 = tcg_constant_i32(0xff);
+            tmp3 = tcg_constant_i32((insn & 7) << 3);
             break;
         case 1:
-            tmp2 = tcg_const_i32(0xffff);
-            tmp3 = tcg_const_i32((insn & 3) << 4);
+            tmp2 = tcg_constant_i32(0xffff);
+            tmp3 = tcg_constant_i32((insn & 3) << 4);
             break;
         case 2:
-            tmp2 = tcg_const_i32(0xffffffff);
-            tmp3 = tcg_const_i32((insn & 1) << 5);
+            tmp2 = tcg_constant_i32(0xffffffff);
+            tmp3 = tcg_constant_i32((insn & 1) << 5);
             break;
         default:
-            tmp2 = NULL;
-            tmp3 = NULL;
+            g_assert_not_reached();
         }
         gen_helper_iwmmxt_insr(cpu_M0, cpu_M0, tmp, tmp2, tmp3);
-        tcg_temp_free_i32(tmp3);
-        tcg_temp_free_i32(tmp2);
         tcg_temp_free_i32(tmp);
         gen_op_iwmmxt_movq_wRn_M0(wrd);
         gen_op_iwmmxt_set_mup();
@@ -XXX,XX +XXX,XX @@ static int disas_iwmmxt_insn(DisasContext *s, uint32_t insn)
         rd0 = (insn >> 16) & 0xf;
         rd1 = (insn >> 0) & 0xf;
         gen_op_iwmmxt_movq_M0_wRn(rd0);
-        tmp = tcg_const_i32((insn >> 20) & 3);
         iwmmxt_load_reg(cpu_V1, rd1);
-        gen_helper_iwmmxt_align(cpu_M0, cpu_M0, cpu_V1, tmp);
-        tcg_temp_free_i32(tmp);
+        gen_helper_iwmmxt_align(cpu_M0, cpu_M0, cpu_V1,
+                                tcg_constant_i32((insn >> 20) & 3));
         gen_op_iwmmxt_movq_wRn_M0(wrd);
         gen_op_iwmmxt_set_mup();
         break;
@@ -XXX,XX +XXX,XX @@ static int disas_iwmmxt_insn(DisasContext *s, uint32_t insn)
         wrd = (insn >> 12) & 0xf;
         rd0 = (insn >> 16) & 0xf;
         gen_op_iwmmxt_movq_M0_wRn(rd0);
-        tmp = tcg_const_i32(((insn >> 16) & 0xf0) | (insn & 0x0f));
+        tmp = tcg_constant_i32(((insn >> 16) & 0xf0) | (insn & 0x0f));
         gen_helper_iwmmxt_shufh(cpu_M0, cpu_env, cpu_M0, tmp);
-        tcg_temp_free_i32(tmp);
         gen_op_iwmmxt_movq_wRn_M0(wrd);
         gen_op_iwmmxt_set_mup();
         gen_op_iwmmxt_set_cup();
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-25-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 22 +++++++++-------------
 1 file changed, 9 insertions(+), 13 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static bool msr_banked_access_decode(DisasContext *s, int r, int sysm, int rn,
                 tcg_gen_sextract_i32(tcg_el, tcg_el, ctz32(SCR_EEL2), 1);
                 tcg_gen_addi_i32(tcg_el, tcg_el, 3);
             } else {
-                tcg_el = tcg_const_i32(3);
+                tcg_el = tcg_constant_i32(3);
             }
 
             gen_exception_el(s, EXCP_UDEF, syn_uncategorized(), tcg_el);
@@ -XXX,XX +XXX,XX @@ undef:
 
 static void gen_msr_banked(DisasContext *s, int r, int sysm, int rn)
 {
-    TCGv_i32 tcg_reg, tcg_tgtmode, tcg_regno;
+    TCGv_i32 tcg_reg;
     int tgtmode = 0, regno = 0;
 
     if (!msr_banked_access_decode(s, r, sysm, rn, &tgtmode, &regno)) {
@@ -XXX,XX +XXX,XX @@ static void gen_msr_banked(DisasContext *s, int r, int sysm, int rn)
     gen_set_condexec(s);
     gen_set_pc_im(s, s->pc_curr);
     tcg_reg = load_reg(s, rn);
-    tcg_tgtmode = tcg_const_i32(tgtmode);
-    tcg_regno = tcg_const_i32(regno);
-    gen_helper_msr_banked(cpu_env, tcg_reg, tcg_tgtmode, tcg_regno);
-    tcg_temp_free_i32(tcg_tgtmode);
-    tcg_temp_free_i32(tcg_regno);
+    gen_helper_msr_banked(cpu_env, tcg_reg,
+                          tcg_constant_i32(tgtmode),
+                          tcg_constant_i32(regno));
     tcg_temp_free_i32(tcg_reg);
     s->base.is_jmp = DISAS_UPDATE_EXIT;
 }
 
 static void gen_mrs_banked(DisasContext *s, int r, int sysm, int rn)
 {
-    TCGv_i32 tcg_reg, tcg_tgtmode, tcg_regno;
+    TCGv_i32 tcg_reg;
     int tgtmode = 0, regno = 0;
 
     if (!msr_banked_access_decode(s, r, sysm, rn, &tgtmode, &regno)) {
@@ -XXX,XX +XXX,XX @@ static void gen_mrs_banked(DisasContext *s, int r, int sysm, int rn)
     gen_set_condexec(s);
     gen_set_pc_im(s, s->pc_curr);
     tcg_reg = tcg_temp_new_i32();
-    tcg_tgtmode = tcg_const_i32(tgtmode);
-    tcg_regno = tcg_const_i32(regno);
-    gen_helper_mrs_banked(tcg_reg, cpu_env, tcg_tgtmode, tcg_regno);
-    tcg_temp_free_i32(tcg_tgtmode);
-    tcg_temp_free_i32(tcg_regno);
+    gen_helper_mrs_banked(tcg_reg, cpu_env,
+                          tcg_constant_i32(tgtmode),
+                          tcg_constant_i32(regno));
     store_reg(s, rn, tcg_reg);
     s->base.is_jmp = DISAS_UPDATE_EXIT;
 }
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-26-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 27 +++++++++------------------
 1 file changed, 9 insertions(+), 18 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ void gen_gvec_sqrdmlsh_qc(unsigned vece, uint32_t rd_ofs, uint32_t rn_ofs,
     }                                                                   \
     static void gen_##NAME##0_vec(unsigned vece, TCGv_vec d, TCGv_vec a) \
     {                                                                   \
-        TCGv_vec zero = tcg_const_zeros_vec_matching(d);                \
+        TCGv_vec zero = tcg_constant_vec_matching(d, vece, 0);          \
         tcg_gen_cmp_vec(COND, vece, d, a, zero);                        \
-        tcg_temp_free_vec(zero);                                        \
     }                                                                   \
     void gen_gvec_##NAME##0(unsigned vece, uint32_t d, uint32_t m,      \
                             uint32_t opr_sz, uint32_t max_sz)           \
@@ -XXX,XX +XXX,XX @@ void gen_ushl_i32(TCGv_i32 dst, TCGv_i32 src, TCGv_i32 shift)
     TCGv_i32 rval = tcg_temp_new_i32();
     TCGv_i32 lsh = tcg_temp_new_i32();
     TCGv_i32 rsh = tcg_temp_new_i32();
-    TCGv_i32 zero = tcg_const_i32(0);
-    TCGv_i32 max = tcg_const_i32(32);
+    TCGv_i32 zero = tcg_constant_i32(0);
+    TCGv_i32 max = tcg_constant_i32(32);
 
     /*
      * Rely on the TCG guarantee that out of range shifts produce
@@ -XXX,XX +XXX,XX @@ void gen_ushl_i32(TCGv_i32 dst, TCGv_i32 src, TCGv_i32 shift)
     tcg_temp_free_i32(rval);
     tcg_temp_free_i32(lsh);
     tcg_temp_free_i32(rsh);
-    tcg_temp_free_i32(zero);
-    tcg_temp_free_i32(max);
 }
 
 void gen_ushl_i64(TCGv_i64 dst, TCGv_i64 src, TCGv_i64 shift)
@@ -XXX,XX +XXX,XX @@ void gen_ushl_i64(TCGv_i64 dst, TCGv_i64 src, TCGv_i64 shift)
     TCGv_i64 rval = tcg_temp_new_i64();
     TCGv_i64 lsh = tcg_temp_new_i64();
     TCGv_i64 rsh = tcg_temp_new_i64();
-    TCGv_i64 zero = tcg_const_i64(0);
-    TCGv_i64 max = tcg_const_i64(64);
+    TCGv_i64 zero = tcg_constant_i64(0);
+    TCGv_i64 max = tcg_constant_i64(64);
 
     /*
      * Rely on the TCG guarantee that out of range shifts produce
@@ -XXX,XX +XXX,XX @@ void gen_ushl_i64(TCGv_i64 dst, TCGv_i64 src, TCGv_i64 shift)
     tcg_temp_free_i64(rval);
     tcg_temp_free_i64(lsh);
     tcg_temp_free_i64(rsh);
-    tcg_temp_free_i64(zero);
-    tcg_temp_free_i64(max);
 }
 
 static void gen_ushl_vec(unsigned vece, TCGv_vec dst,
@@ -XXX,XX +XXX,XX @@ void gen_sshl_i32(TCGv_i32 dst, TCGv_i32 src, TCGv_i32 shift)
     TCGv_i32 rval = tcg_temp_new_i32();
     TCGv_i32 lsh = tcg_temp_new_i32();
     TCGv_i32 rsh = tcg_temp_new_i32();
-    TCGv_i32 zero = tcg_const_i32(0);
-    TCGv_i32 max = tcg_const_i32(31);
+    TCGv_i32 zero = tcg_constant_i32(0);
+    TCGv_i32 max = tcg_constant_i32(31);
 
     /*
      * Rely on the TCG guarantee that out of range shifts produce
@@ -XXX,XX +XXX,XX @@ void gen_sshl_i32(TCGv_i32 dst, TCGv_i32 src, TCGv_i32 shift)
     tcg_temp_free_i32(rval);
     tcg_temp_free_i32(lsh);
     tcg_temp_free_i32(rsh);
-    tcg_temp_free_i32(zero);
-    tcg_temp_free_i32(max);
 }
 
 void gen_sshl_i64(TCGv_i64 dst, TCGv_i64 src, TCGv_i64 shift)
@@ -XXX,XX +XXX,XX @@ void gen_sshl_i64(TCGv_i64 dst, TCGv_i64 src, TCGv_i64 shift)
     TCGv_i64 rval = tcg_temp_new_i64();
     TCGv_i64 lsh = tcg_temp_new_i64();
     TCGv_i64 rsh = tcg_temp_new_i64();
-    TCGv_i64 zero = tcg_const_i64(0);
-    TCGv_i64 max = tcg_const_i64(63);
+    TCGv_i64 zero = tcg_constant_i64(0);
+    TCGv_i64 max = tcg_constant_i64(63);
 
     /*
      * Rely on the TCG guarantee that out of range shifts produce
@@ -XXX,XX +XXX,XX @@ void gen_sshl_i64(TCGv_i64 dst, TCGv_i64 src, TCGv_i64 shift)
     tcg_temp_free_i64(rval);
     tcg_temp_free_i64(lsh);
     tcg_temp_free_i64(rsh);
-    tcg_temp_free_i64(zero);
-    tcg_temp_free_i64(max);
 }
 
 static void gen_sshl_vec(unsigned vece, TCGv_vec dst,
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-27-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 43 +++++++++++++-----------------------------
 1 file changed, 13 insertions(+), 30 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void do_coproc_insn(DisasContext *s, int cpnum, int is64,
              * Note that on XScale all cp0..c13 registers do an access check
              * call in order to handle c15_cpar.
              */
-            TCGv_ptr tmpptr;
-            TCGv_i32 tcg_syn, tcg_isread;
             uint32_t syndrome;
 
             /* Note that since we are an implementation which takes an
@@ -XXX,XX +XXX,XX @@ static void do_coproc_insn(DisasContext *s, int cpnum, int is64,
 
             gen_set_condexec(s);
             gen_set_pc_im(s, s->pc_curr);
-            tmpptr = tcg_const_ptr(ri);
-            tcg_syn = tcg_const_i32(syndrome);
-            tcg_isread = tcg_const_i32(isread);
-            gen_helper_access_check_cp_reg(cpu_env, tmpptr, tcg_syn,
-                                           tcg_isread);
-            tcg_temp_free_ptr(tmpptr);
-            tcg_temp_free_i32(tcg_syn);
-            tcg_temp_free_i32(tcg_isread);
+            gen_helper_access_check_cp_reg(cpu_env,
+                                           tcg_constant_ptr(ri),
+                                           tcg_constant_i32(syndrome),
+                                           tcg_constant_i32(isread));
         } else if (ri->type & ARM_CP_RAISES_EXC) {
             /*
              * The readfn or writefn might raise an exception;
@@ -XXX,XX +XXX,XX @@ static void do_coproc_insn(DisasContext *s, int cpnum, int is64,
                 TCGv_i64 tmp64;
                 TCGv_i32 tmp;
                 if (ri->type & ARM_CP_CONST) {
-                    tmp64 = tcg_const_i64(ri->resetvalue);
+                    tmp64 = tcg_constant_i64(ri->resetvalue);
                 } else if (ri->readfn) {
-                    TCGv_ptr tmpptr;
                     tmp64 = tcg_temp_new_i64();
-                    tmpptr = tcg_const_ptr(ri);
-                    gen_helper_get_cp_reg64(tmp64, cpu_env, tmpptr);
-                    tcg_temp_free_ptr(tmpptr);
+                    gen_helper_get_cp_reg64(tmp64, cpu_env,
+                                            tcg_constant_ptr(ri));
                 } else {
                     tmp64 = tcg_temp_new_i64();
                     tcg_gen_ld_i64(tmp64, cpu_env, ri->fieldoffset);
@@ -XXX,XX +XXX,XX @@ static void do_coproc_insn(DisasContext *s, int cpnum, int is64,
             } else {
                 TCGv_i32 tmp;
                 if (ri->type & ARM_CP_CONST) {
-                    tmp = tcg_const_i32(ri->resetvalue);
+                    tmp = tcg_constant_i32(ri->resetvalue);
                 } else if (ri->readfn) {
-                    TCGv_ptr tmpptr;
                     tmp = tcg_temp_new_i32();
-                    tmpptr = tcg_const_ptr(ri);
-                    gen_helper_get_cp_reg(tmp, cpu_env, tmpptr);
-                    tcg_temp_free_ptr(tmpptr);
+                    gen_helper_get_cp_reg(tmp, cpu_env, tcg_constant_ptr(ri));
                 } else {
                     tmp = load_cpu_offset(ri->fieldoffset);
                 }
@@ -XXX,XX +XXX,XX @@ static void do_coproc_insn(DisasContext *s, int cpnum, int is64,
                 tcg_temp_free_i32(tmplo);
                 tcg_temp_free_i32(tmphi);
                 if (ri->writefn) {
-                    TCGv_ptr tmpptr = tcg_const_ptr(ri);
-                    gen_helper_set_cp_reg64(cpu_env, tmpptr, tmp64);
-                    tcg_temp_free_ptr(tmpptr);
+                    gen_helper_set_cp_reg64(cpu_env, tcg_constant_ptr(ri),
+                                            tmp64);
                 } else {
                     tcg_gen_st_i64(tmp64, cpu_env, ri->fieldoffset);
                 }
                 tcg_temp_free_i64(tmp64);
             } else {
+                TCGv_i32 tmp = load_reg(s, rt);
                 if (ri->writefn) {
-                    TCGv_i32 tmp;
-                    TCGv_ptr tmpptr;
-                    tmp = load_reg(s, rt);
-                    tmpptr = tcg_const_ptr(ri);
-                    gen_helper_set_cp_reg(cpu_env, tmpptr, tmp);
-                    tcg_temp_free_ptr(tmpptr);
+                    gen_helper_set_cp_reg(cpu_env, tcg_constant_ptr(ri), tmp);
                     tcg_temp_free_i32(tmp);
                 } else {
-                    TCGv_i32 tmp = load_reg(s, rt);
                     store_cpu_offset(tmp, ri->fieldoffset, 4);
                 }
             }
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-28-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 8 ++------
 1 file changed, 2 insertions(+), 6 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void gen_srs(DisasContext *s,
     }
 
     addr = tcg_temp_new_i32();
-    tmp = tcg_const_i32(mode);
     /* get_r13_banked() will raise an exception if called from System mode */
     gen_set_condexec(s);
     gen_set_pc_im(s, s->pc_curr);
-    gen_helper_get_r13_banked(addr, cpu_env, tmp);
-    tcg_temp_free_i32(tmp);
+    gen_helper_get_r13_banked(addr, cpu_env, tcg_constant_i32(mode));
     switch (amode) {
     case 0: /* DA */
         offset = -4;
@@ -XXX,XX +XXX,XX @@ static void gen_srs(DisasContext *s,
             abort();
         }
         tcg_gen_addi_i32(addr, addr, offset);
-        tmp = tcg_const_i32(mode);
-        gen_helper_set_r13_banked(cpu_env, tmp, addr);
-        tcg_temp_free_i32(tmp);
+        gen_helper_set_r13_banked(cpu_env, tcg_constant_i32(mode), addr);
     }
     tcg_temp_free_i32(addr);
     s->base.is_jmp = DISAS_UPDATE_EXIT;
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-29-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 11 +++++------
 1 file changed, 5 insertions(+), 6 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static bool op_s_rri_rot(DisasContext *s, arg_s_rri_rot *a,
                          void (*gen)(TCGv_i32, TCGv_i32, TCGv_i32),
                          int logic_cc, StoreRegKind kind)
 {
-    TCGv_i32 tmp1, tmp2;
+    TCGv_i32 tmp1;
     uint32_t imm;
 
     imm = ror32(a->imm, a->rot);
     if (logic_cc && a->rot) {
         tcg_gen_movi_i32(cpu_CF, imm >> 31);
     }
-    tmp2 = tcg_const_i32(imm);
     tmp1 = load_reg(s, a->rn);
 
-    gen(tmp1, tmp1, tmp2);
-    tcg_temp_free_i32(tmp2);
+    gen(tmp1, tmp1, tcg_constant_i32(imm));
 
     if (logic_cc) {
         gen_logic_CC(tmp1);
@@ -XXX,XX +XXX,XX @@ static bool op_s_rxi_rot(DisasContext *s, arg_s_rri_rot *a,
     if (logic_cc && a->rot) {
         tcg_gen_movi_i32(cpu_CF, imm >> 31);
     }
-    tmp = tcg_const_i32(imm);
 
-    gen(tmp, tmp);
+    tmp = tcg_temp_new_i32();
+    gen(tmp, tcg_constant_i32(imm));
+
     if (logic_cc) {
         gen_logic_CC(tmp);
     }
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-30-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 11 +++--------
 1 file changed, 3 insertions(+), 8 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static bool trans_ADR(DisasContext *s, arg_ri *a)
 
 static bool trans_MOVW(DisasContext *s, arg_MOVW *a)
 {
-    TCGv_i32 tmp;
-
     if (!ENABLE_ARCH_6T2) {
         return false;
     }
 
-    tmp = tcg_const_i32(a->imm);
-    store_reg(s, a->rd, tmp);
+    store_reg(s, a->rd, tcg_constant_i32(a->imm));
     return true;
 }
 
@@ -XXX,XX +XXX,XX @@ static bool trans_UMAAL(DisasContext *s, arg_UMAAL *a)
     t0 = load_reg(s, a->rm);
     t1 = load_reg(s, a->rn);
     tcg_gen_mulu2_i32(t0, t1, t0, t1);
-    zero = tcg_const_i32(0);
+    zero = tcg_constant_i32(0);
     t2 = load_reg(s, a->ra);
     tcg_gen_add2_i32(t0, t1, t0, t1, t2, zero);
     tcg_temp_free_i32(t2);
     t2 = load_reg(s, a->rd);
     tcg_gen_add2_i32(t0, t1, t0, t1, t2, zero);
     tcg_temp_free_i32(t2);
-    tcg_temp_free_i32(zero);
     store_reg(s, a->ra, t0);
     store_reg(s, a->rd, t1);
     return true;
@@ -XXX,XX +XXX,XX @@ static bool op_crc32(DisasContext *s, arg_rrr *a, bool c, MemOp sz)
     default:
         g_assert_not_reached();
     }
-    t3 = tcg_const_i32(1 << sz);
+    t3 = tcg_constant_i32(1 << sz);
     if (c) {
         gen_helper_crc32c(t1, t1, t2, t3);
     } else {
         gen_helper_crc32(t1, t1, t2, t3);
     }
     tcg_temp_free_i32(t2);
-    tcg_temp_free_i32(t3);
     store_reg(s, a->rd, t1);
     return true;
 }
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-31-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 7 +++----
 1 file changed, 3 insertions(+), 4 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static bool trans_MRS_v7m(DisasContext *s, arg_MRS_v7m *a)
     if (!arm_dc_feature(s, ARM_FEATURE_M)) {
         return false;
     }
-    tmp = tcg_const_i32(a->sysm);
-    gen_helper_v7m_mrs(tmp, cpu_env, tmp);
+    tmp = tcg_temp_new_i32();
+    gen_helper_v7m_mrs(tmp, cpu_env, tcg_constant_i32(a->sysm));
     store_reg(s, a->rd, tmp);
     return true;
 }
@@ -XXX,XX +XXX,XX @@ static bool trans_MSR_v7m(DisasContext *s, arg_MSR_v7m *a)
     if (!arm_dc_feature(s, ARM_FEATURE_M)) {
         return false;
     }
-    addr = tcg_const_i32((a->mask << 10) | a->sysm);
+    addr = tcg_constant_i32((a->mask << 10) | a->sysm);
     reg = load_reg(s, a->rn);
     gen_helper_v7m_msr(cpu_env, addr, reg);
-    tcg_temp_free_i32(addr);
     tcg_temp_free_i32(reg);
     /* If we wrote to CONTROL, the EL might have changed */
     gen_rebuild_hflags(s, true);
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-32-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 14 +++++---------
 1 file changed, 5 insertions(+), 9 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static bool trans_TT(DisasContext *s, arg_TT *a)
     }
 
     addr = load_reg(s, a->rn);
-    tmp = tcg_const_i32((a->A << 1) | a->T);
-    gen_helper_v7m_tt(tmp, cpu_env, addr, tmp);
+    tmp = tcg_temp_new_i32();
+    gen_helper_v7m_tt(tmp, cpu_env, addr, tcg_constant_i32((a->A << 1) | a->T));
     tcg_temp_free_i32(addr);
     store_reg(s, a->rd, tmp);
     return true;
@@ -XXX,XX +XXX,XX @@ static bool trans_PKH(DisasContext *s, arg_PKH *a)
 static bool op_sat(DisasContext *s, arg_sat *a,
                    void (*gen)(TCGv_i32, TCGv_env, TCGv_i32, TCGv_i32))
 {
-    TCGv_i32 tmp, satimm;
+    TCGv_i32 tmp;
     int shift = a->imm;
 
     if (!ENABLE_ARCH_6) {
@@ -XXX,XX +XXX,XX @@ static bool op_sat(DisasContext *s, arg_sat *a,
         tcg_gen_shli_i32(tmp, tmp, shift);
     }
 
-    satimm = tcg_const_i32(a->satimm);
-    gen(tmp, cpu_env, tmp, satimm);
-    tcg_temp_free_i32(satimm);
+    gen(tmp, cpu_env, tmp, tcg_constant_i32(a->satimm));
 
     store_reg(s, a->rd, tmp);
     return true;
@@ -XXX,XX +XXX,XX @@ static bool op_smmla(DisasContext *s, arg_rrrr *a, bool round, bool sub)
              * a non-zero multiplicand lowpart, and the correct result
              * lowpart for rounding.
              */
-            TCGv_i32 zero = tcg_const_i32(0);
-            tcg_gen_sub2_i32(t2, t1, zero, t3, t2, t1);
-            tcg_temp_free_i32(zero);
+            tcg_gen_sub2_i32(t2, t1, tcg_constant_i32(0), t3, t2, t1);
         } else {
             tcg_gen_add_i32(t1, t1, t3);
         }
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-33-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 12 ++++--------
 1 file changed, 4 insertions(+), 8 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static bool op_stm(DisasContext *s, arg_ldst_block *a, int min_n)
 {
     int i, j, n, list, mem_idx;
     bool user = a->u;
-    TCGv_i32 addr, tmp, tmp2;
+    TCGv_i32 addr, tmp;
 
     if (user) {
         /* STM (user) */
@@ -XXX,XX +XXX,XX @@ static bool op_stm(DisasContext *s, arg_ldst_block *a, int min_n)
 
         if (user && i != 15) {
             tmp = tcg_temp_new_i32();
-            tmp2 = tcg_const_i32(i);
-            gen_helper_get_user_reg(tmp, cpu_env, tmp2);
-            tcg_temp_free_i32(tmp2);
+            gen_helper_get_user_reg(tmp, cpu_env, tcg_constant_i32(i));
         } else {
             tmp = load_reg(s, i);
         }
@@ -XXX,XX +XXX,XX @@ static bool do_ldm(DisasContext *s, arg_ldst_block *a, int min_n)
     bool loaded_base;
     bool user = a->u;
     bool exc_return = false;
-    TCGv_i32 addr, tmp, tmp2, loaded_var;
+    TCGv_i32 addr, tmp, loaded_var;
 
     if (user) {
         /* LDM (user), LDM (exception return) */
@@ -XXX,XX +XXX,XX @@ static bool do_ldm(DisasContext *s, arg_ldst_block *a, int min_n)
         tmp = tcg_temp_new_i32();
         gen_aa32_ld_i32(s, tmp, addr, mem_idx, MO_UL | MO_ALIGN);
         if (user) {
-            tmp2 = tcg_const_i32(i);
-            gen_helper_set_user_reg(cpu_env, tmp2, tmp);
-            tcg_temp_free_i32(tmp2);
+            gen_helper_set_user_reg(cpu_env, tcg_constant_i32(i), tmp);
             tcg_temp_free_i32(tmp);
         } else if (i == a->rn) {
             loaded_var = tmp;
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-34-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 16 +++++-----------
 1 file changed, 5 insertions(+), 11 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static bool trans_CLRM(DisasContext *s, arg_CLRM *a)
 
     s->eci_handled = true;
 
-    zero = tcg_const_i32(0);
+    zero = tcg_constant_i32(0);
     for (i = 0; i < 15; i++) {
         if (extract32(a->list, i, 1)) {
             /* Clear R[i] */
@@ -XXX,XX +XXX,XX @@ static bool trans_CLRM(DisasContext *s, arg_CLRM *a)
          * Clear APSR (by calling the MSR helper with the same argument
          * as for "MSR APSR_nzcvqg, Rn": mask = 0b1100, SYSM=0)
          */
-        TCGv_i32 maskreg = tcg_const_i32(0xc << 8);
-        gen_helper_v7m_msr(cpu_env, maskreg, zero);
-        tcg_temp_free_i32(maskreg);
+        gen_helper_v7m_msr(cpu_env, tcg_constant_i32(0xc00), zero);
     }
-    tcg_temp_free_i32(zero);
     clear_eci_state(s);
     return true;
 }
@@ -XXX,XX +XXX,XX @@ static bool trans_DLS(DisasContext *s, arg_DLS *a)
     store_reg(s, 14, tmp);
     if (a->size != 4) {
         /* DLSTP: set FPSCR.LTPSIZE */
-        tmp = tcg_const_i32(a->size);
-        store_cpu_field(tmp, v7m.ltpsize);
+        store_cpu_field(tcg_constant_i32(a->size), v7m.ltpsize);
         s->base.is_jmp = DISAS_UPDATE_NOCHAIN;
     }
     return true;
@@ -XXX,XX +XXX,XX @@ static bool trans_WLS(DisasContext *s, arg_WLS *a)
          */
         bool ok = vfp_access_check(s);
         assert(ok);
-        tmp = tcg_const_i32(a->size);
-        store_cpu_field(tmp, v7m.ltpsize);
+        store_cpu_field(tcg_constant_i32(a->size), v7m.ltpsize);
         /*
          * LTPSIZE updated, but MVE_NO_PRED will always be the same thing (0)
          * when we take this upcoming exit from this TB, so gen_jmp_tb() is OK.
@@ -XXX,XX +XXX,XX @@ static bool trans_LE(DisasContext *s, arg_LE *a)
     gen_set_label(loopend);
     if (a->tp) {
         /* Exits from tail-pred loops must reset LTPSIZE to 4 */
-        tmp = tcg_const_i32(4);
-        store_cpu_field(tmp, v7m.ltpsize);
+        store_cpu_field(tcg_constant_i32(4), v7m.ltpsize);
     }
     /* End TB, continuing to following insn */
     gen_jmp_tb(s, s->base.pc_next, 1);
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-35-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 9 +++------
 1 file changed, 3 insertions(+), 6 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static bool trans_CPS_v7m(DisasContext *s, arg_CPS_v7m *a)
         return true;
     }
 
-    tmp = tcg_const_i32(a->im);
+    tmp = tcg_constant_i32(a->im);
     /* FAULTMASK */
     if (a->F) {
-        addr = tcg_const_i32(19);
+        addr = tcg_constant_i32(19);
         gen_helper_v7m_msr(cpu_env, addr, tmp);
-        tcg_temp_free_i32(addr);
     }
     /* PRIMASK */
     if (a->I) {
-        addr = tcg_const_i32(16);
+        addr = tcg_constant_i32(16);
         gen_helper_v7m_msr(cpu_env, addr, tmp);
-        tcg_temp_free_i32(addr);
     }
     gen_rebuild_hflags(s, false);
-    tcg_temp_free_i32(tmp);
     gen_lookup_tb(s);
     return true;
 }
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-36-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 7 +++----
 1 file changed, 3 insertions(+), 4 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static bool trans_CSEL(DisasContext *s, arg_CSEL *a)
     }
 
     /* In this insn input reg fields of 0b1111 mean "zero", not "PC" */
+    zero = tcg_constant_i32(0);
     if (a->rn == 15) {
-        rn = tcg_const_i32(0);
+        rn = zero;
     } else {
         rn = load_reg(s, a->rn);
     }
     if (a->rm == 15) {
-        rm = tcg_const_i32(0);
+        rm = zero;
     } else {
         rm = load_reg(s, a->rm);
     }
@@ -XXX,XX +XXX,XX @@ static bool trans_CSEL(DisasContext *s, arg_CSEL *a)
     }
 
     arm_test_cc(&c, a->fcond);
-    zero = tcg_const_i32(0);
     tcg_gen_movcond_i32(c.cond, rn, c.value, zero, rn, rm);
     arm_free_cc(&c);
-    tcg_temp_free_i32(zero);
 
     store_reg(s, a->rd, rn);
     tcg_temp_free_i32(rm);
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-37-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 12 ++++--------
 1 file changed, 4 insertions(+), 8 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static void do_index(DisasContext *s, int esz, int rd,
 static bool trans_INDEX_ii(DisasContext *s, arg_INDEX_ii *a)
 {
     if (sve_access_check(s)) {
-        TCGv_i64 start = tcg_const_i64(a->imm1);
-        TCGv_i64 incr = tcg_const_i64(a->imm2);
+        TCGv_i64 start = tcg_constant_i64(a->imm1);
+        TCGv_i64 incr = tcg_constant_i64(a->imm2);
         do_index(s, a->esz, a->rd, start, incr);
-        tcg_temp_free_i64(start);
-        tcg_temp_free_i64(incr);
     }
     return true;
 }
@@ -XXX,XX +XXX,XX @@ static bool trans_INDEX_ii(DisasContext *s, arg_INDEX_ii *a)
 static bool trans_INDEX_ir(DisasContext *s, arg_INDEX_ir *a)
 {
     if (sve_access_check(s)) {
-        TCGv_i64 start = tcg_const_i64(a->imm);
+        TCGv_i64 start = tcg_constant_i64(a->imm);
         TCGv_i64 incr = cpu_reg(s, a->rm);
         do_index(s, a->esz, a->rd, start, incr);
-        tcg_temp_free_i64(start);
     }
     return true;
 }
@@ -XXX,XX +XXX,XX @@ static bool trans_INDEX_ri(DisasContext *s, arg_INDEX_ri *a)
 {
     if (sve_access_check(s)) {
         TCGv_i64 start = cpu_reg(s, a->rn);
-        TCGv_i64 incr = tcg_const_i64(a->imm);
+        TCGv_i64 incr = tcg_constant_i64(a->imm);
         do_index(s, a->esz, a->rd, start, incr);
-        tcg_temp_free_i64(incr);
     }
     return true;
 }
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-38-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 18 ++++++------------
 1 file changed, 6 insertions(+), 12 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_SINCDEC_r_32(DisasContext *s, arg_incdec_cnt *a)
             tcg_gen_ext32s_i64(reg, reg);
         }
     } else {
-        TCGv_i64 t = tcg_const_i64(inc);
-        do_sat_addsub_32(reg, t, a->u, a->d);
-        tcg_temp_free_i64(t);
+        do_sat_addsub_32(reg, tcg_constant_i64(inc), a->u, a->d);
     }
     return true;
 }
@@ -XXX,XX +XXX,XX @@ static bool trans_SINCDEC_r_64(DisasContext *s, arg_incdec_cnt *a)
     TCGv_i64 reg = cpu_reg(s, a->rd);
 
     if (inc != 0) {
-        TCGv_i64 t = tcg_const_i64(inc);
-        do_sat_addsub_64(reg, t, a->u, a->d);
-        tcg_temp_free_i64(t);
+        do_sat_addsub_64(reg, tcg_constant_i64(inc), a->u, a->d);
     }
     return true;
 }
@@ -XXX,XX +XXX,XX @@ static bool trans_INCDEC_v(DisasContext *s, arg_incdec2_cnt *a)
 
     if (inc != 0) {
         if (sve_access_check(s)) {
-            TCGv_i64 t = tcg_const_i64(a->d ? -inc : inc);
             tcg_gen_gvec_adds(a->esz, vec_full_reg_offset(s, a->rd),
                               vec_full_reg_offset(s, a->rn),
-                              t, fullsz, fullsz);
-            tcg_temp_free_i64(t);
+                              tcg_constant_i64(a->d ? -inc : inc),
+                              fullsz, fullsz);
         }
     } else {
         do_mov_z(s, a->rd, a->rn);
@@ -XXX,XX +XXX,XX @@ static bool trans_SINCDEC_v(DisasContext *s, arg_incdec2_cnt *a)
 
     if (inc != 0) {
         if (sve_access_check(s)) {
-            TCGv_i64 t = tcg_const_i64(inc);
-            do_sat_addsub_vec(s, a->esz, a->rd, a->rn, t, a->u, a->d);
-            tcg_temp_free_i64(t);
+            do_sat_addsub_vec(s, a->esz, a->rd, a->rn,
+                              tcg_constant_i64(inc), a->u, a->d);
         }
     } else {
         do_mov_z(s, a->rd, a->rn);
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-39-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 13 ++++---------
 1 file changed, 4 insertions(+), 9 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_FCPY(DisasContext *s, arg_FCPY *a)
     if (sve_access_check(s)) {
         /* Decode the VFP immediate.  */
         uint64_t imm = vfp_expand_imm(a->esz, a->imm);
-        TCGv_i64 t_imm = tcg_const_i64(imm);
-        do_cpy_m(s, a->esz, a->rd, a->rn, a->pg, t_imm);
-        tcg_temp_free_i64(t_imm);
+        do_cpy_m(s, a->esz, a->rd, a->rn, a->pg, tcg_constant_i64(imm));
     }
     return true;
 }
@@ -XXX,XX +XXX,XX @@ static bool trans_CPY_m_i(DisasContext *s, arg_rpri_esz *a)
         return false;
     }
     if (sve_access_check(s)) {
-        TCGv_i64 t_imm = tcg_const_i64(a->imm);
-        do_cpy_m(s, a->esz, a->rd, a->rn, a->pg, t_imm);
-        tcg_temp_free_i64(t_imm);
+        do_cpy_m(s, a->esz, a->rd, a->rn, a->pg, tcg_constant_i64(a->imm));
     }
     return true;
 }
@@ -XXX,XX +XXX,XX @@ static bool trans_CPY_z_i(DisasContext *s, arg_CPY_z_i *a)
     }
     if (sve_access_check(s)) {
         unsigned vsz = vec_full_reg_size(s);
-        TCGv_i64 t_imm = tcg_const_i64(a->imm);
         tcg_gen_gvec_2i_ool(vec_full_reg_offset(s, a->rd),
                             pred_full_reg_offset(s, a->pg),
-                            t_imm, vsz, vsz, 0, fns[a->esz]);
-        tcg_temp_free_i64(t_imm);
+                            tcg_constant_i64(a->imm),
+                            vsz, vsz, 0, fns[a->esz]);
     }
     return true;
 }
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-40-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 12 ++++--------
 1 file changed, 4 insertions(+), 8 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static void incr_last_active(DisasContext *s, TCGv_i32 last, int esz)
     if (is_power_of_2(vsz)) {
         tcg_gen_andi_i32(last, last, vsz - 1);
     } else {
-        TCGv_i32 max = tcg_const_i32(vsz);
-        TCGv_i32 zero = tcg_const_i32(0);
+        TCGv_i32 max = tcg_constant_i32(vsz);
+        TCGv_i32 zero = tcg_constant_i32(0);
         tcg_gen_movcond_i32(TCG_COND_GEU, last, last, max, zero, last);
-        tcg_temp_free_i32(max);
-        tcg_temp_free_i32(zero);
     }
 }
 
@@ -XXX,XX +XXX,XX @@ static void wrap_last_active(DisasContext *s, TCGv_i32 last, int esz)
     if (is_power_of_2(vsz)) {
         tcg_gen_andi_i32(last, last, vsz - 1);
     } else {
-        TCGv_i32 max = tcg_const_i32(vsz - (1 << esz));
-        TCGv_i32 zero = tcg_const_i32(0);
+        TCGv_i32 max = tcg_constant_i32(vsz - (1 << esz));
+        TCGv_i32 zero = tcg_constant_i32(0);
         tcg_gen_movcond_i32(TCG_COND_LT, last, last, zero, max, last);
-        tcg_temp_free_i32(max);
-        tcg_temp_free_i32(zero);
     }
 }
 
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-41-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 7 +++----
 1 file changed, 3 insertions(+), 4 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static void do_clast_scalar(DisasContext *s, int esz, int pg, int rm,
                             bool before, TCGv_i64 reg_val)
 {
     TCGv_i32 last = tcg_temp_new_i32();
-    TCGv_i64 ele, cmp, zero;
+    TCGv_i64 ele, cmp;
 
     find_last_active(s, last, esz, pg);
 
@@ -XXX,XX +XXX,XX @@ static void do_clast_scalar(DisasContext *s, int esz, int pg, int rm,
     ele = load_last_active(s, last, rm, esz);
     tcg_temp_free_i32(last);
 
-    zero = tcg_const_i64(0);
-    tcg_gen_movcond_i64(TCG_COND_GE, reg_val, cmp, zero, ele, reg_val);
+    tcg_gen_movcond_i64(TCG_COND_GE, reg_val, cmp, tcg_constant_i64(0),
+                        ele, reg_val);
 
-    tcg_temp_free_i64(zero);
     tcg_temp_free_i64(cmp);
     tcg_temp_free_i64(ele);
 }
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-42-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 20 +++++++-------------
 1 file changed, 7 insertions(+), 13 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_CTERM(DisasContext *s, arg_CTERM *a)
 static bool trans_WHILE(DisasContext *s, arg_WHILE *a)
 {
     TCGv_i64 op0, op1, t0, t1, tmax;
-    TCGv_i32 t2, t3;
+    TCGv_i32 t2;
     TCGv_ptr ptr;
     unsigned vsz = vec_full_reg_size(s);
     unsigned desc = 0;
@@ -XXX,XX +XXX,XX @@ static bool trans_WHILE(DisasContext *s, arg_WHILE *a)
         }
     }
 
-    tmax = tcg_const_i64(vsz >> a->esz);
+    tmax = tcg_constant_i64(vsz >> a->esz);
     if (eq) {
         /* Equality means one more iteration.  */
         tcg_gen_addi_i64(t0, t0, 1);
@@ -XXX,XX +XXX,XX @@ static bool trans_WHILE(DisasContext *s, arg_WHILE *a)
 
     /* Bound to the maximum.  */
     tcg_gen_umin_i64(t0, t0, tmax);
-    tcg_temp_free_i64(tmax);
 
     /* Set the count to zero if the condition is false.  */
     tcg_gen_movi_i64(t1, 0);
@@ -XXX,XX +XXX,XX @@ static bool trans_WHILE(DisasContext *s, arg_WHILE *a)
 
     desc = FIELD_DP32(desc, PREDDESC, OPRSZ, vsz / 8);
     desc = FIELD_DP32(desc, PREDDESC, ESZ, a->esz);
-    t3 = tcg_const_i32(desc);
 
     ptr = tcg_temp_new_ptr();
     tcg_gen_addi_ptr(ptr, cpu_env, pred_full_reg_offset(s, a->rd));
 
     if (a->lt) {
-        gen_helper_sve_whilel(t2, ptr, t2, t3);
+        gen_helper_sve_whilel(t2, ptr, t2, tcg_constant_i32(desc));
     } else {
-        gen_helper_sve_whileg(t2, ptr, t2, t3);
+        gen_helper_sve_whileg(t2, ptr, t2, tcg_constant_i32(desc));
     }
     do_pred_flags(t2);
 
     tcg_temp_free_ptr(ptr);
     tcg_temp_free_i32(t2);
-    tcg_temp_free_i32(t3);
     return true;
 }
 
 static bool trans_WHILE_ptr(DisasContext *s, arg_WHILE_ptr *a)
 {
     TCGv_i64 op0, op1, diff, t1, tmax;
-    TCGv_i32 t2, t3;
+    TCGv_i32 t2;
     TCGv_ptr ptr;
     unsigned vsz = vec_full_reg_size(s);
     unsigned desc = 0;
@@ -XXX,XX +XXX,XX @@ static bool trans_WHILE_ptr(DisasContext *s, arg_WHILE_ptr *a)
     op0 = read_cpu_reg(s, a->rn, 1);
     op1 = read_cpu_reg(s, a->rm, 1);
 
-    tmax = tcg_const_i64(vsz);
+    tmax = tcg_constant_i64(vsz);
     diff = tcg_temp_new_i64();
 
     if (a->rw) {
@@ -XXX,XX +XXX,XX @@ static bool trans_WHILE_ptr(DisasContext *s, arg_WHILE_ptr *a)
 
     /* Bound to the maximum.  */
     tcg_gen_umin_i64(diff, diff, tmax);
-    tcg_temp_free_i64(tmax);
 
     /* Since we're bounded, pass as a 32-bit type.  */
     t2 = tcg_temp_new_i32();
@@ -XXX,XX +XXX,XX @@ static bool trans_WHILE_ptr(DisasContext *s, arg_WHILE_ptr *a)
 
     desc = FIELD_DP32(desc, PREDDESC, OPRSZ, vsz / 8);
     desc = FIELD_DP32(desc, PREDDESC, ESZ, a->esz);
-    t3 = tcg_const_i32(desc);
 
     ptr = tcg_temp_new_ptr();
     tcg_gen_addi_ptr(ptr, cpu_env, pred_full_reg_offset(s, a->rd));
 
-    gen_helper_sve_whilel(t2, ptr, t2, t3);
+    gen_helper_sve_whilel(t2, ptr, t2, tcg_constant_i32(desc));
     do_pred_flags(t2);
 
     tcg_temp_free_ptr(ptr);
     tcg_temp_free_i32(t2);
-    tcg_temp_free_i32(t3);
     return true;
 }
 
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-43-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 12 ++++--------
 1 file changed, 4 insertions(+), 8 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_LD1_zpiz(DisasContext *s, arg_LD1_zpiz *a)
     gen_helper_gvec_mem_scatter *fn = NULL;
     bool be = s->be_data == MO_BE;
     bool mte = s->mte_active[0];
-    TCGv_i64 imm;
 
     if (a->esz < a->msz || (a->esz == a->msz && !a->u)) {
         return false;
@@ -XXX,XX +XXX,XX @@ static bool trans_LD1_zpiz(DisasContext *s, arg_LD1_zpiz *a)
     /* Treat LD1_zpiz (zn[x] + imm) the same way as LD1_zprz (rn + zm[x])
      * by loading the immediate into the scalar parameter.
      */
-    imm = tcg_const_i64(a->imm << a->msz);
-    do_mem_zpz(s, a->rd, a->pg, a->rn, 0, imm, a->msz, false, fn);
-    tcg_temp_free_i64(imm);
+    do_mem_zpz(s, a->rd, a->pg, a->rn, 0,
+               tcg_constant_i64(a->imm << a->msz), a->msz, false, fn);
     return true;
 }
 
@@ -XXX,XX +XXX,XX @@ static bool trans_ST1_zpiz(DisasContext *s, arg_ST1_zpiz *a)
     gen_helper_gvec_mem_scatter *fn = NULL;
     bool be = s->be_data == MO_BE;
     bool mte = s->mte_active[0];
-    TCGv_i64 imm;
 
     if (a->esz < a->msz) {
         return false;
@@ -XXX,XX +XXX,XX @@ static bool trans_ST1_zpiz(DisasContext *s, arg_ST1_zpiz *a)
     /* Treat ST1_zpiz (zn[x] + imm) the same way as ST1_zprz (rn + zm[x])
      * by loading the immediate into the scalar parameter.
      */
-    imm = tcg_const_i64(a->imm << a->msz);
-    do_mem_zpz(s, a->rd, a->pg, a->rn, 0, imm, a->msz, true, fn);
-    tcg_temp_free_i64(imm);
+    do_mem_zpz(s, a->rd, a->pg, a->rn, 0,
+               tcg_constant_i64(a->imm << a->msz), a->msz, true, fn);
     return true;
 }
 
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-44-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 4 +---
 1 file changed, 1 insertion(+), 3 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_SUBR_zzi(DisasContext *s, arg_rri_esz *a)
     }
     if (sve_access_check(s)) {
         unsigned vsz = vec_full_reg_size(s);
-        TCGv_i64 c = tcg_const_i64(a->imm);
         tcg_gen_gvec_2s(vec_full_reg_offset(s, a->rd),
                         vec_full_reg_offset(s, a->rn),
-                        vsz, vsz, c, &op[a->esz]);
-        tcg_temp_free_i64(c);
+                        vsz, vsz, tcg_constant_i64(a->imm), &op[a->esz]);
     }
     return true;
 }
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-45-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 15 +++++----------
 1 file changed, 5 insertions(+), 10 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

In these cases, 't' did double-duty as zero source and
temporary destination.  Split the two uses.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-46-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 17 ++++++++---------
 1 file changed, 8 insertions(+), 9 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static void do_predtest(DisasContext *s, int dofs, int gofs, int words)
 {
     TCGv_ptr dptr = tcg_temp_new_ptr();
     TCGv_ptr gptr = tcg_temp_new_ptr();
-    TCGv_i32 t;
+    TCGv_i32 t = tcg_temp_new_i32();
 
     tcg_gen_addi_ptr(dptr, cpu_env, dofs);
     tcg_gen_addi_ptr(gptr, cpu_env, gofs);
-    t = tcg_const_i32(words);
 
-    gen_helper_sve_predtest(t, dptr, gptr, t);
+    gen_helper_sve_predtest(t, dptr, gptr, tcg_constant_i32(words));
     tcg_temp_free_ptr(dptr);
     tcg_temp_free_ptr(gptr);
 
@@ -XXX,XX +XXX,XX @@ static bool do_pfirst_pnext(DisasContext *s, arg_rr_esz *a,
 
     tcg_gen_addi_ptr(t_pd, cpu_env, pred_full_reg_offset(s, a->rd));
     tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, a->rn));
-    t = tcg_const_i32(desc);
+    t = tcg_temp_new_i32();
 
-    gen_fn(t, t_pd, t_pg, t);
+    gen_fn(t, t_pd, t_pg, tcg_constant_i32(desc));
     tcg_temp_free_ptr(t_pd);
     tcg_temp_free_ptr(t_pg);
 
@@ -XXX,XX +XXX,XX @@ static bool do_ppzz_flags(DisasContext *s, arg_rprr_esz *a,
     }
 
     vsz = vec_full_reg_size(s);
-    t = tcg_const_i32(simd_desc(vsz, vsz, 0));
+    t = tcg_temp_new_i32();
     pd = tcg_temp_new_ptr();
     zn = tcg_temp_new_ptr();
     zm = tcg_temp_new_ptr();
@@ -XXX,XX +XXX,XX @@ static bool do_ppzz_flags(DisasContext *s, arg_rprr_esz *a,
     tcg_gen_addi_ptr(zm, cpu_env, vec_full_reg_offset(s, a->rm));
     tcg_gen_addi_ptr(pg, cpu_env, pred_full_reg_offset(s, a->pg));
 
-    gen_fn(t, pd, zn, zm, pg, t);
+    gen_fn(t, pd, zn, zm, pg, tcg_constant_i32(simd_desc(vsz, vsz, 0)));
 
     tcg_temp_free_ptr(pd);
     tcg_temp_free_ptr(zn);
@@ -XXX,XX +XXX,XX @@ static bool do_ppzi_flags(DisasContext *s, arg_rpri_esz *a,
     }
 
     vsz = vec_full_reg_size(s);
-    t = tcg_const_i32(simd_desc(vsz, vsz, a->imm));
+    t = tcg_temp_new_i32();
     pd = tcg_temp_new_ptr();
     zn = tcg_temp_new_ptr();
     pg = tcg_temp_new_ptr();
@@ -XXX,XX +XXX,XX @@ static bool do_ppzi_flags(DisasContext *s, arg_rpri_esz *a,
     tcg_gen_addi_ptr(zn, cpu_env, vec_full_reg_offset(s, a->rn));
     tcg_gen_addi_ptr(pg, cpu_env, pred_full_reg_offset(s, a->pg));
 
-    gen_fn(t, pd, zn, pg, t);
+    gen_fn(t, pd, zn, pg, tcg_constant_i32(simd_desc(vsz, vsz, a->imm)));
 
     tcg_temp_free_ptr(pd);
     tcg_temp_free_ptr(zn);
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

In these cases, 't' did double-duty as zero source and
temporary destination.  Split the two uses and narrow
the scope of the temp.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-47-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 18 ++++++++++--------
 1 file changed, 10 insertions(+), 8 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_brk3(DisasContext *s, arg_rprr_s *a,
     TCGv_ptr n = tcg_temp_new_ptr();
     TCGv_ptr m = tcg_temp_new_ptr();
     TCGv_ptr g = tcg_temp_new_ptr();
-    TCGv_i32 t = tcg_const_i32(FIELD_DP32(0, PREDDESC, OPRSZ, vsz));
+    TCGv_i32 desc = tcg_constant_i32(FIELD_DP32(0, PREDDESC, OPRSZ, vsz));
 
     tcg_gen_addi_ptr(d, cpu_env, pred_full_reg_offset(s, a->rd));
     tcg_gen_addi_ptr(n, cpu_env, pred_full_reg_offset(s, a->rn));
@@ -XXX,XX +XXX,XX @@ static bool do_brk3(DisasContext *s, arg_rprr_s *a,
     tcg_gen_addi_ptr(g, cpu_env, pred_full_reg_offset(s, a->pg));
 
     if (a->s) {
-        fn_s(t, d, n, m, g, t);
+        TCGv_i32 t = tcg_temp_new_i32();
+        fn_s(t, d, n, m, g, desc);
         do_pred_flags(t);
+        tcg_temp_free_i32(t);
     } else {
-        fn(d, n, m, g, t);
+        fn(d, n, m, g, desc);
     }
     tcg_temp_free_ptr(d);
     tcg_temp_free_ptr(n);
     tcg_temp_free_ptr(m);
     tcg_temp_free_ptr(g);
-    tcg_temp_free_i32(t);
     return true;
 }
 
@@ -XXX,XX +XXX,XX @@ static bool do_brk2(DisasContext *s, arg_rpr_s *a,
     TCGv_ptr d = tcg_temp_new_ptr();
     TCGv_ptr n = tcg_temp_new_ptr();
     TCGv_ptr g = tcg_temp_new_ptr();
-    TCGv_i32 t = tcg_const_i32(FIELD_DP32(0, PREDDESC, OPRSZ, vsz));
+    TCGv_i32 desc = tcg_constant_i32(FIELD_DP32(0, PREDDESC, OPRSZ, vsz));
 
     tcg_gen_addi_ptr(d, cpu_env, pred_full_reg_offset(s, a->rd));
     tcg_gen_addi_ptr(n, cpu_env, pred_full_reg_offset(s, a->rn));
     tcg_gen_addi_ptr(g, cpu_env, pred_full_reg_offset(s, a->pg));
 
     if (a->s) {
-        fn_s(t, d, n, g, t);
+        TCGv_i32 t = tcg_temp_new_i32();
+        fn_s(t, d, n, g, desc);
         do_pred_flags(t);
+        tcg_temp_free_i32(t);
     } else {
-        fn(d, n, g, t);
+        fn(d, n, g, desc);
     }
     tcg_temp_free_ptr(d);
     tcg_temp_free_ptr(n);
     tcg_temp_free_ptr(g);
-    tcg_temp_free_i32(t);
     return true;
 }
 
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20220426163043.100432-48-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 54 ++++++++++----------------------------
 1 file changed, 14 insertions(+), 40 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_vpz_ool(DisasContext *s, arg_rpr_esz *a,
         return true;
     }
 
-    desc = tcg_const_i32(simd_desc(vsz, vsz, 0));
+    desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
     temp = tcg_temp_new_i64();
     t_zn = tcg_temp_new_ptr();
     t_pg = tcg_temp_new_ptr();
@@ -XXX,XX +XXX,XX @@ static bool do_vpz_ool(DisasContext *s, arg_rpr_esz *a,
     fn(temp, t_zn, t_pg, desc);
     tcg_temp_free_ptr(t_zn);
     tcg_temp_free_ptr(t_pg);
-    tcg_temp_free_i32(desc);
 
     write_fp_dreg(s, a->rd, temp);
     tcg_temp_free_i64(temp);
@@ -XXX,XX +XXX,XX @@ static void do_index(DisasContext *s, int esz, int rd,
                      TCGv_i64 start, TCGv_i64 incr)
 {
     unsigned vsz = vec_full_reg_size(s);
-    TCGv_i32 desc = tcg_const_i32(simd_desc(vsz, vsz, 0));
+    TCGv_i32 desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
     TCGv_ptr t_zd = tcg_temp_new_ptr();
 
     tcg_gen_addi_ptr(t_zd, cpu_env, vec_full_reg_offset(s, rd));
@@ -XXX,XX +XXX,XX @@ static void do_index(DisasContext *s, int esz, int rd,
         tcg_temp_free_i32(i32);
     }
     tcg_temp_free_ptr(t_zd);
-    tcg_temp_free_i32(desc);
 }
 
 static bool trans_INDEX_ii(DisasContext *s, arg_INDEX_ii *a)
@@ -XXX,XX +XXX,XX @@ static void do_sat_addsub_vec(DisasContext *s, int esz, int rd, int rn,
     nptr = tcg_temp_new_ptr();
     tcg_gen_addi_ptr(dptr, cpu_env, vec_full_reg_offset(s, rd));
     tcg_gen_addi_ptr(nptr, cpu_env, vec_full_reg_offset(s, rn));
-    desc = tcg_const_i32(simd_desc(vsz, vsz, 0));
+    desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
 
     switch (esz) {
     case MO_8:
@@ -XXX,XX +XXX,XX @@ static void do_sat_addsub_vec(DisasContext *s, int esz, int rd, int rn,
 
     tcg_temp_free_ptr(dptr);
     tcg_temp_free_ptr(nptr);
-    tcg_temp_free_i32(desc);
 }
 
 static bool trans_CNT_r(DisasContext *s, arg_CNT_r *a)
@@ -XXX,XX +XXX,XX @@ static void do_cpy_m(DisasContext *s, int esz, int rd, int rn, int pg,
         gen_helper_sve_cpy_m_s, gen_helper_sve_cpy_m_d,
     };
     unsigned vsz = vec_full_reg_size(s);
-    TCGv_i32 desc = tcg_const_i32(simd_desc(vsz, vsz, 0));
+    TCGv_i32 desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
     TCGv_ptr t_zd = tcg_temp_new_ptr();
     TCGv_ptr t_zn = tcg_temp_new_ptr();
     TCGv_ptr t_pg = tcg_temp_new_ptr();
@@ -XXX,XX +XXX,XX @@ static void do_cpy_m(DisasContext *s, int esz, int rd, int rn, int pg,
     tcg_temp_free_ptr(t_zd);
     tcg_temp_free_ptr(t_zn);
     tcg_temp_free_ptr(t_pg);
-    tcg_temp_free_i32(desc);
 }
 
 static bool trans_FCPY(DisasContext *s, arg_FCPY *a)
@@ -XXX,XX +XXX,XX @@ static void do_insr_i64(DisasContext *s, arg_rrr_esz *a, TCGv_i64 val)
         gen_helper_sve_insr_s, gen_helper_sve_insr_d,
     };
     unsigned vsz = vec_full_reg_size(s);
-    TCGv_i32 desc = tcg_const_i32(simd_desc(vsz, vsz, 0));
+    TCGv_i32 desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
     TCGv_ptr t_zd = tcg_temp_new_ptr();
     TCGv_ptr t_zn = tcg_temp_new_ptr();
 
@@ -XXX,XX +XXX,XX @@ static void do_insr_i64(DisasContext *s, arg_rrr_esz *a, TCGv_i64 val)
 
     tcg_temp_free_ptr(t_zd);
     tcg_temp_free_ptr(t_zn);
-    tcg_temp_free_i32(desc);
 }
 
 static bool trans_INSR_f(DisasContext *s, arg_rrr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool do_perm_pred3(DisasContext *s, arg_rrr_esz *a, bool high_odd,
     TCGv_ptr t_d = tcg_temp_new_ptr();
     TCGv_ptr t_n = tcg_temp_new_ptr();
     TCGv_ptr t_m = tcg_temp_new_ptr();
-    TCGv_i32 t_desc;
     uint32_t desc = 0;
 
     desc = FIELD_DP32(desc, PREDDESC, OPRSZ, vsz);
@@ -XXX,XX +XXX,XX @@ static bool do_perm_pred3(DisasContext *s, arg_rrr_esz *a, bool high_odd,
     tcg_gen_addi_ptr(t_d, cpu_env, pred_full_reg_offset(s, a->rd));
     tcg_gen_addi_ptr(t_n, cpu_env, pred_full_reg_offset(s, a->rn));
     tcg_gen_addi_ptr(t_m, cpu_env, pred_full_reg_offset(s, a->rm));
-    t_desc = tcg_const_i32(desc);
 
-    fn(t_d, t_n, t_m, t_desc);
+    fn(t_d, t_n, t_m, tcg_constant_i32(desc));
 
     tcg_temp_free_ptr(t_d);
     tcg_temp_free_ptr(t_n);
     tcg_temp_free_ptr(t_m);
-    tcg_temp_free_i32(t_desc);
     return true;
 }
 
@@ -XXX,XX +XXX,XX @@ static bool do_perm_pred2(DisasContext *s, arg_rr_esz *a, bool high_odd,
     unsigned vsz = pred_full_reg_size(s);
     TCGv_ptr t_d = tcg_temp_new_ptr();
     TCGv_ptr t_n = tcg_temp_new_ptr();
-    TCGv_i32 t_desc;
     uint32_t desc = 0;
 
     tcg_gen_addi_ptr(t_d, cpu_env, pred_full_reg_offset(s, a->rd));
@@ -XXX,XX +XXX,XX @@ static bool do_perm_pred2(DisasContext *s, arg_rr_esz *a, bool high_odd,
     desc = FIELD_DP32(desc, PREDDESC, OPRSZ, vsz);
     desc = FIELD_DP32(desc, PREDDESC, ESZ, a->esz);
     desc = FIELD_DP32(desc, PREDDESC, DATA, high_odd);
-    t_desc = tcg_const_i32(desc);
 
-    fn(t_d, t_n, t_desc);
+    fn(t_d, t_n, tcg_constant_i32(desc));
 
-    tcg_temp_free_i32(t_desc);
     tcg_temp_free_ptr(t_d);
     tcg_temp_free_ptr(t_n);
     return true;
@@ -XXX,XX +XXX,XX @@ static void find_last_active(DisasContext *s, TCGv_i32 ret, int esz, int pg)
      * round up, as we do elsewhere, because we need the exact size.
      */
     TCGv_ptr t_p = tcg_temp_new_ptr();
-    TCGv_i32 t_desc;
     unsigned desc = 0;
 
     desc = FIELD_DP32(desc, PREDDESC, OPRSZ, pred_full_reg_size(s));
     desc = FIELD_DP32(desc, PREDDESC, ESZ, esz);
 
     tcg_gen_addi_ptr(t_p, cpu_env, pred_full_reg_offset(s, pg));
-    t_desc = tcg_const_i32(desc);
 
-    gen_helper_sve_last_active_element(ret, t_p, t_desc);
+    gen_helper_sve_last_active_element(ret, t_p, tcg_constant_i32(desc));
 
-    tcg_temp_free_i32(t_desc);
     tcg_temp_free_ptr(t_p);
 }
 
@@ -XXX,XX +XXX,XX @@ static void do_cntp(DisasContext *s, TCGv_i64 val, int esz, int pn, int pg)
         TCGv_ptr t_pn = tcg_temp_new_ptr();
         TCGv_ptr t_pg = tcg_temp_new_ptr();
         unsigned desc = 0;
-        TCGv_i32 t_desc;
 
         desc = FIELD_DP32(desc, PREDDESC, OPRSZ, psz);
         desc = FIELD_DP32(desc, PREDDESC, ESZ, esz);
 
         tcg_gen_addi_ptr(t_pn, cpu_env, pred_full_reg_offset(s, pn));
         tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, pg));
-        t_desc = tcg_const_i32(desc);
 
-        gen_helper_sve_cntp(val, t_pn, t_pg, t_desc);
+        gen_helper_sve_cntp(val, t_pn, t_pg, tcg_constant_i32(desc));
         tcg_temp_free_ptr(t_pn);
         tcg_temp_free_ptr(t_pg);
-        tcg_temp_free_i32(t_desc);
     }
 }
 
@@ -XXX,XX +XXX,XX @@ static void do_reduce(DisasContext *s, arg_rpr_esz *a,
 {
     unsigned vsz = vec_full_reg_size(s);
     unsigned p2vsz = pow2ceil(vsz);
-    TCGv_i32 t_desc = tcg_const_i32(simd_desc(vsz, vsz, p2vsz));
+    TCGv_i32 t_desc = tcg_constant_i32(simd_desc(vsz, vsz, p2vsz));
     TCGv_ptr t_zn, t_pg, status;
     TCGv_i64 temp;
 
@@ -XXX,XX +XXX,XX @@ static void do_reduce(DisasContext *s, arg_rpr_esz *a,
     tcg_temp_free_ptr(t_zn);
     tcg_temp_free_ptr(t_pg);
     tcg_temp_free_ptr(status);
-    tcg_temp_free_i32(t_desc);
 
     write_fp_dreg(s, a->rd, temp);
     tcg_temp_free_i64(temp);
@@ -XXX,XX +XXX,XX @@ static bool trans_FADDA(DisasContext *s, arg_rprr_esz *a)
     tcg_gen_addi_ptr(t_rm, cpu_env, vec_full_reg_offset(s, a->rm));
     tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, a->pg));
     t_fpst = fpstatus_ptr(a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
-    t_desc = tcg_const_i32(simd_desc(vsz, vsz, 0));
+    t_desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
 
     fns[a->esz - 1](t_val, t_val, t_rm, t_pg, t_fpst, t_desc);
 
-    tcg_temp_free_i32(t_desc);
     tcg_temp_free_ptr(t_fpst);
     tcg_temp_free_ptr(t_pg);
     tcg_temp_free_ptr(t_rm);
@@ -XXX,XX +XXX,XX @@ static void do_fp_scalar(DisasContext *s, int zd, int zn, int pg, bool is_fp16,
     tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, pg));
 
     status = fpstatus_ptr(is_fp16 ? FPST_FPCR_F16 : FPST_FPCR);
-    desc = tcg_const_i32(simd_desc(vsz, vsz, 0));
+    desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
     fn(t_zd, t_zn, t_pg, scalar, status, desc);
 
-    tcg_temp_free_i32(desc);
     tcg_temp_free_ptr(status);
     tcg_temp_free_ptr(t_pg);
     tcg_temp_free_ptr(t_zn);
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
 {
     unsigned vsz = vec_full_reg_size(s);
     TCGv_ptr t_pg;
-    TCGv_i32 t_desc;
     int desc = 0;
 
     /*
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
     }
 
     desc = simd_desc(vsz, vsz, zt | desc);
-    t_desc = tcg_const_i32(desc);
     t_pg = tcg_temp_new_ptr();
 
     tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, pg));
-    fn(cpu_env, t_pg, addr, t_desc);
+    fn(cpu_env, t_pg, addr, tcg_constant_i32(desc));
 
     tcg_temp_free_ptr(t_pg);
-    tcg_temp_free_i32(t_desc);
 }
 
 /* Indexed by [mte][be][dtype][nreg] */
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpz(DisasContext *s, int zt, int pg, int zm,
     TCGv_ptr t_zm = tcg_temp_new_ptr();
     TCGv_ptr t_pg = tcg_temp_new_ptr();
     TCGv_ptr t_zt = tcg_temp_new_ptr();
-    TCGv_i32 t_desc;
     int desc = 0;
 
     if (s->mte_active[0]) {
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpz(DisasContext *s, int zt, int pg, int zm,
         desc <<= SVE_MTEDESC_SHIFT;
     }
     desc = simd_desc(vsz, vsz, desc | scale);
-    t_desc = tcg_const_i32(desc);
 
     tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, pg));
     tcg_gen_addi_ptr(t_zm, cpu_env, vec_full_reg_offset(s, zm));
     tcg_gen_addi_ptr(t_zt, cpu_env, vec_full_reg_offset(s, zt));
-    fn(cpu_env, t_zt, t_pg, t_zm, scalar, t_desc);
+    fn(cpu_env, t_zt, t_pg, t_zm, scalar, tcg_constant_i32(desc));
 
     tcg_temp_free_ptr(t_zt);
     tcg_temp_free_ptr(t_zm);
     tcg_temp_free_ptr(t_pg);
-    tcg_temp_free_i32(t_desc);
 }
 
 /* Indexed by [mte][be][ff][xs][u][msz].  */
-- 
2.25.1

From: Damien Hedde <damien.hedde@greensocs.com>

As of now, cryptographic instructions ISAR fields are never cleared so
we can end up with a cpu with cryptographic instructions but no
floating-point/neon instructions which is not a possible configuration
according to Arm specifications.

In QEMU, we have 3 kinds of cpus regarding cryptographic instructions:
+ no support
+ cortex-a57/a72: cryptographic extension is optional,
  floating-point/neon is not.
+ cortex-a53: crytographic extension is optional as well as
  floating-point/neon. But cryptographic requires
  floating-point/neon support.

Therefore we can safely clear the ISAR fields when neon is disabled.

Note that other Arm cpus seem to follow this. For example cortex-a55 is
like cortex-a53 and cortex-a76/cortex-a710 are like cortex-a57/a72.

Signed-off-by: Damien Hedde <damien.hedde@greensocs.com>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220427090117.6954-1-damien.hedde@greensocs.com
[PMM: fixed commit message typos]
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.c | 9 +++++++++
 1 file changed, 9 insertions(+)

diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
         unset_feature(env, ARM_FEATURE_NEON);
 
         t = cpu->isar.id_aa64isar0;
+        t = FIELD_DP64(t, ID_AA64ISAR0, AES, 0);
+        t = FIELD_DP64(t, ID_AA64ISAR0, SHA1, 0);
+        t = FIELD_DP64(t, ID_AA64ISAR0, SHA2, 0);
+        t = FIELD_DP64(t, ID_AA64ISAR0, SHA3, 0);
+        t = FIELD_DP64(t, ID_AA64ISAR0, SM3, 0);
+        t = FIELD_DP64(t, ID_AA64ISAR0, SM4, 0);
         t = FIELD_DP64(t, ID_AA64ISAR0, DP, 0);
         cpu->isar.id_aa64isar0 = t;
 
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
         cpu->isar.id_aa64pfr0 = t;
 
         u = cpu->isar.id_isar5;
+        u = FIELD_DP32(u, ID_ISAR5, AES, 0);
+        u = FIELD_DP32(u, ID_ISAR5, SHA1, 0);
+        u = FIELD_DP32(u, ID_ISAR5, SHA2, 0);
         u = FIELD_DP32(u, ID_ISAR5, RDM, 0);
         u = FIELD_DP32(u, ID_ISAR5, VCMA, 0);
         cpu->isar.id_isar5 = u;
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

While defining these names, use the correct field width of 5 not 4 for
DBGWCR.MASK.  This typo prevented setting a watchpoint larger than 32k.

Reported-by: Chris Howard <cvz185@web.de>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Alex Bennée <alex.bennee@linaro.org>
Message-id: 20220427051926.295223-1-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/internals.h    | 12 ++++++++++++
 target/arm/debug_helper.c | 10 +++++-----
 target/arm/helper.c       |  8 ++++----
 target/arm/kvm64.c        | 14 +++++++-------
 4 files changed, 28 insertions(+), 16 deletions(-)

diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ FIELD(V7M_EXCRET, RES1, 7, 25) /* including the must-be-1 prefix */
  */
 #define FNC_RETURN_MIN_MAGIC 0xfefffffe
 
+/* Bit definitions for DBGWCRn and DBGWCRn_EL1 */
+FIELD(DBGWCR, E, 0, 1)
+FIELD(DBGWCR, PAC, 1, 2)
+FIELD(DBGWCR, LSC, 3, 2)
+FIELD(DBGWCR, BAS, 5, 8)
+FIELD(DBGWCR, HMC, 13, 1)
+FIELD(DBGWCR, SSC, 14, 2)
+FIELD(DBGWCR, LBN, 16, 4)
+FIELD(DBGWCR, WT, 20, 1)
+FIELD(DBGWCR, MASK, 24, 5)
+FIELD(DBGWCR, SSCE, 29, 1)
+
 /* We use a few fake FSR values for internal purposes in M profile.
  * M profile cores don't have A/R format FSRs, but currently our
  * get_phys_addr() code assumes A/R profile and reports failures via
diff --git a/target/arm/debug_helper.c b/target/arm/debug_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/debug_helper.c
+++ b/target/arm/debug_helper.c
@@ -XXX,XX +XXX,XX @@ static bool bp_wp_matches(ARMCPU *cpu, int n, bool is_wp)
      * Non-Secure to simplify the code slightly compared to the full
      * table in the ARM ARM.
      */
-    pac = extract64(cr, 1, 2);
-    hmc = extract64(cr, 13, 1);
-    ssc = extract64(cr, 14, 2);
+    pac = FIELD_EX64(cr, DBGWCR, PAC);
+    hmc = FIELD_EX64(cr, DBGWCR, HMC);
+    ssc = FIELD_EX64(cr, DBGWCR, SSC);
 
     switch (ssc) {
     case 0:
@@ -XXX,XX +XXX,XX @@ static bool bp_wp_matches(ARMCPU *cpu, int n, bool is_wp)
         g_assert_not_reached();
     }
 
-    wt = extract64(cr, 20, 1);
-    lbn = extract64(cr, 16, 4);
+    wt = FIELD_EX64(cr, DBGWCR, WT);
+    lbn = FIELD_EX64(cr, DBGWCR, LBN);
 
     if (wt && !linked_bp_matches(cpu, lbn)) {
         return false;
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void hw_watchpoint_update(ARMCPU *cpu, int n)
         env->cpu_watchpoint[n] = NULL;
     }
 
-    if (!extract64(wcr, 0, 1)) {
+    if (!FIELD_EX64(wcr, DBGWCR, E)) {
         /* E bit clear : watchpoint disabled */
         return;
     }
 
-    switch (extract64(wcr, 3, 2)) {
+    switch (FIELD_EX64(wcr, DBGWCR, LSC)) {
     case 0:
         /* LSC 00 is reserved and must behave as if the wp is disabled */
         return;
@@ -XXX,XX +XXX,XX @@ void hw_watchpoint_update(ARMCPU *cpu, int n)
      * CONSTRAINED UNPREDICTABLE; we opt to ignore BAS in this case,
      * thus generating a watchpoint for every byte in the masked region.
      */
-    mask = extract64(wcr, 24, 4);
+    mask = FIELD_EX64(wcr, DBGWCR, MASK);
     if (mask == 1 || mask == 2) {
         /* Reserved values of MASK; we must act as if the mask value was
          * some non-reserved value, or as if the watchpoint were disabled.
@@ -XXX,XX +XXX,XX @@ void hw_watchpoint_update(ARMCPU *cpu, int n)
         wvr &= ~(len - 1);
     } else {
         /* Watchpoint covers bytes defined by the byte address select bits */
-        int bas = extract64(wcr, 5, 8);
+        int bas = FIELD_EX64(wcr, DBGWCR, BAS);
         int basstart;
 
         if (extract64(wvr, 2, 1)) {
diff --git a/target/arm/kvm64.c b/target/arm/kvm64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/kvm64.c
+++ b/target/arm/kvm64.c
@@ -XXX,XX +XXX,XX @@ static int insert_hw_watchpoint(target_ulong addr,
                                 target_ulong len, int type)
 {
     HWWatchpoint wp = {
-        .wcr = 1, /* E=1, enable */
+        .wcr = R_DBGWCR_E_MASK, /* E=1, enable */
         .wvr = addr & (~0x7ULL),
         .details = { .vaddr = addr, .len = len }
     };
@@ -XXX,XX +XXX,XX @@ static int insert_hw_watchpoint(target_ulong addr,
      * HMC=0 SSC=0 PAC=3 will hit EL0 or EL1, any security state,
      * valid whether EL3 is implemented or not
      */
-    wp.wcr = deposit32(wp.wcr, 1, 2, 3);
+    wp.wcr = FIELD_DP64(wp.wcr, DBGWCR, PAC, 3);
 
     switch (type) {
     case GDB_WATCHPOINT_READ:
-        wp.wcr = deposit32(wp.wcr, 3, 2, 1);
+        wp.wcr = FIELD_DP64(wp.wcr, DBGWCR, LSC, 1);
         wp.details.flags = BP_MEM_READ;
         break;
     case GDB_WATCHPOINT_WRITE:
-        wp.wcr = deposit32(wp.wcr, 3, 2, 2);
+        wp.wcr = FIELD_DP64(wp.wcr, DBGWCR, LSC, 2);
         wp.details.flags = BP_MEM_WRITE;
         break;
     case GDB_WATCHPOINT_ACCESS:
-        wp.wcr = deposit32(wp.wcr, 3, 2, 3);
+        wp.wcr = FIELD_DP64(wp.wcr, DBGWCR, LSC, 3);
         wp.details.flags = BP_MEM_ACCESS;
         break;
     default:
@@ -XXX,XX +XXX,XX @@ static int insert_hw_watchpoint(target_ulong addr,
             int bits = ctz64(len);
 
             wp.wvr &= ~((1 << bits) - 1);
-            wp.wcr = deposit32(wp.wcr, 24, 4, bits);
-            wp.wcr = deposit32(wp.wcr, 5, 8, 0xff);
+            wp.wcr = FIELD_DP64(wp.wcr, DBGWCR, MASK, bits);
+            wp.wcr = FIELD_DP64(wp.wcr, DBGWCR, BAS, 0xff);
         } else {
             return -ENOBUFS;
         }
-- 
2.25.1

From: Jean-Philippe Brucker <jean-philippe@linaro.org>

The Record bit in the Context Descriptor tells the SMMU to report fault
events to the event queue. Since we don't cache the Record bit at the
moment, access faults from a cached Context Descriptor are never
reported. Store the Record bit in the cached SMMUTransCfg.

Fixes: 9bde7f0674fe ("hw/arm/smmuv3: Implement translate callback")
Signed-off-by: Jean-Philippe Brucker <jean-philippe@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Eric Auger <eric.auger@redhat.com>
Message-id: 20220427111543.124620-1-jean-philippe@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/arm/smmuv3-internal.h     |  1 -
 include/hw/arm/smmu-common.h |  1 +
 hw/arm/smmuv3.c              | 14 +++++++-------
 3 files changed, 8 insertions(+), 8 deletions(-)

diff --git a/hw/arm/smmuv3-internal.h b/hw/arm/smmuv3-internal.h
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/smmuv3-internal.h
+++ b/hw/arm/smmuv3-internal.h
@@ -XXX,XX +XXX,XX @@ typedef struct SMMUEventInfo {
     SMMUEventType type;
     uint32_t sid;
     bool recorded;
-    bool record_trans_faults;
     bool inval_ste_allowed;
     union {
         struct {
diff --git a/include/hw/arm/smmu-common.h b/include/hw/arm/smmu-common.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/arm/smmu-common.h
+++ b/include/hw/arm/smmu-common.h
@@ -XXX,XX +XXX,XX @@ typedef struct SMMUTransCfg {
     bool disabled;             /* smmu is disabled */
     bool bypassed;             /* translation is bypassed */
     bool aborted;              /* translation is aborted */
+    bool record_faults;        /* record fault events */
     uint64_t ttb;              /* TT base address */
     uint8_t oas;               /* output address width */
     uint8_t tbi;               /* Top Byte Ignore */
diff --git a/hw/arm/smmuv3.c b/hw/arm/smmuv3.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/smmuv3.c
+++ b/hw/arm/smmuv3.c
@@ -XXX,XX +XXX,XX @@ static int decode_cd(SMMUTransCfg *cfg, CD *cd, SMMUEventInfo *event)
         trace_smmuv3_decode_cd_tt(i, tt->tsz, tt->ttb, tt->granule_sz, tt->had);
     }
 
-    event->record_trans_faults = CD_R(cd);
+    cfg->record_faults = CD_R(cd);
 
     return 0;
 
@@ -XXX,XX +XXX,XX @@ static IOMMUTLBEntry smmuv3_translate(IOMMUMemoryRegion *mr, hwaddr addr,
 
     tt = select_tt(cfg, addr);
     if (!tt) {
-        if (event.record_trans_faults) {
+        if (cfg->record_faults) {
             event.type = SMMU_EVT_F_TRANSLATION;
             event.u.f_translation.addr = addr;
             event.u.f_translation.rnw = flag & 0x1;
@@ -XXX,XX +XXX,XX @@ static IOMMUTLBEntry smmuv3_translate(IOMMUMemoryRegion *mr, hwaddr addr,
     if (cached_entry) {
         if ((flag & IOMMU_WO) && !(cached_entry->entry.perm & IOMMU_WO)) {
             status = SMMU_TRANS_ERROR;
-            if (event.record_trans_faults) {
+            if (cfg->record_faults) {
                 event.type = SMMU_EVT_F_PERMISSION;
                 event.u.f_permission.addr = addr;
                 event.u.f_permission.rnw = flag & 0x1;
@@ -XXX,XX +XXX,XX @@ static IOMMUTLBEntry smmuv3_translate(IOMMUMemoryRegion *mr, hwaddr addr,
             event.u.f_walk_eabt.addr2 = ptw_info.addr;
             break;
         case SMMU_PTW_ERR_TRANSLATION:
-            if (event.record_trans_faults) {
+            if (cfg->record_faults) {
                 event.type = SMMU_EVT_F_TRANSLATION;
                 event.u.f_translation.addr = addr;
                 event.u.f_translation.rnw = flag & 0x1;
             }
             break;
         case SMMU_PTW_ERR_ADDR_SIZE:
-            if (event.record_trans_faults) {
+            if (cfg->record_faults) {
                 event.type = SMMU_EVT_F_ADDR_SIZE;
                 event.u.f_addr_size.addr = addr;
                 event.u.f_addr_size.rnw = flag & 0x1;
             }
             break;
         case SMMU_PTW_ERR_ACCESS:
-            if (event.record_trans_faults) {
+            if (cfg->record_faults) {
                 event.type = SMMU_EVT_F_ACCESS;
                 event.u.f_access.addr = addr;
                 event.u.f_access.rnw = flag & 0x1;
             }
             break;
         case SMMU_PTW_ERR_PERMISSION:
-            if (event.record_trans_faults) {
+            if (cfg->record_faults) {
                 event.type = SMMU_EVT_F_PERMISSION;
                 event.u.f_permission.addr = addr;
                 event.u.f_permission.rnw = flag & 0x1;
-- 
2.25.1

From: Jean-Philippe Brucker <jean-philippe@linaro.org>

Make the translation error message prettier by adding a missing space
before the parenthesis.

Signed-off-by: Jean-Philippe Brucker <jean-philippe@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Eric Auger <eric.auger@redhat.com>
Message-id: 20220427111543.124620-2-jean-philippe@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/arm/smmuv3.c | 2 +-
 1 file changed, 1 insertion(+), 1 deletion(-)

diff --git a/hw/arm/smmuv3.c b/hw/arm/smmuv3.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/smmuv3.c
+++ b/hw/arm/smmuv3.c
@@ -XXX,XX +XXX,XX @@ epilogue:
         break;
     case SMMU_TRANS_ERROR:
         qemu_log_mask(LOG_GUEST_ERROR,
-                      "%s translation failed for iova=0x%"PRIx64"(%s)\n",
+                      "%s translation failed for iova=0x%"PRIx64" (%s)\n",
                       mr->parent_obj.name, addr, smmu_event_string(event.type));
         smmuv3_record_event(s, &event);
         break;
-- 
2.25.1

The Arm FEAT_TTL architectural feature allows the guest to provide an
optional hint in an AArch64 TLB invalidate operation about which
translation table level holds the leaf entry for the address being
invalidated.  QEMU's TLB implementation doesn't need that hint, and
we correctly ignore the (previously RES0) bits in TLB invalidate
operation values that are now used for the TTL field.  So we can
simply advertise support for it in our 'max' CPU.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220426160422.2353158-2-peter.maydell@linaro.org
---
 docs/system/arm/emulation.rst | 1 +
 target/arm/cpu64.c            | 1 +
 2 files changed, 2 insertions(+)

diff --git a/docs/system/arm/emulation.rst b/docs/system/arm/emulation.rst
index XXXXXXX..XXXXXXX 100644
--- a/docs/system/arm/emulation.rst
+++ b/docs/system/arm/emulation.rst
@@ -XXX,XX +XXX,XX @@ the following architecture extensions:
 - FEAT_TLBIOS (TLB invalidate instructions in Outer Shareable domain)
 - FEAT_TLBIRANGE (TLB invalidate range instructions)
 - FEAT_TTCNP (Translation table Common not private translations)
+- FEAT_TTL (Translation Table Level)
 - FEAT_TTST (Small translation tables)
 - FEAT_UAO (Unprivileged Access Override control)
 - FEAT_VHE (Virtualization Host Extensions)
diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu64.c
+++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
     t = FIELD_DP64(t, ID_AA64MMFR2, CNP, 1); /* TTCNP */
     t = FIELD_DP64(t, ID_AA64MMFR2, ST, 1); /* TTST */
     t = FIELD_DP64(t, ID_AA64MMFR2, VARANGE, 1); /* FEAT_LVA */
+    t = FIELD_DP64(t, ID_AA64MMFR2, TTL, 1); /* FEAT_TTL */
     cpu->isar.id_aa64mmfr2 = t;
 
     t = cpu->isar.id_aa64zfr0;
-- 
2.25.1

The description in the Arm ARM of the requirements of FEAT_BBM is
admirably clear on the guarantees it provides software, but slightly
more obscure on what that means for implementations.  The description
of the equivalent SMMU feature in the SMMU specification (IHI0070D.b
section 3.21.1) is perhaps a bit more detailed and includes some
example valid implementation choices. (The SMMU version of this
feature is slightly tighter than the CPU version: the CPU is permitted
to raise TLB Conflict aborts in some situations that the SMMU may
not. This doesn't matter for QEMU because we don't want to do TLB
Conflict aborts anyway.)

The informal summary of FEAT_BBM is that it is about permitting an OS
to switch a range of memory between "covered by a huge page" and
"covered by a sequence of normal pages" without having to engage in
the 'break-before-make' dance that has traditionally been
necessary. The 'break-before-make' sequence is:

* replace the old translation table entry with an invalid entry
 * execute a DSB insn
 * execute a broadcast TLB invalidate insn
 * execute a DSB insn
 * write the new translation table entry
 * execute a DSB insn

The point of this is to ensure that no TLB can simultaneously contain
TLB entries for the old and the new entry, which would traditionally
be UNPREDICTABLE (allowing the CPU to generate a TLB Conflict fault
or to use a random mishmash of values from the old and the new
entry).  FEAT_BBM level 2 says "for the specific case where the only
thing that changed is the size of the block, the TLB is guaranteed
not to do weird things even if there are multiple entries for an
address", which means that software can now do:

* replace old translation table entry with new entry
 * DSB
 * broadcast TLB invalidate
 * DSB

As the SMMU spec notes, valid ways to do this include:

* if there are multiple entries in the TLB for an address,
   choose one of them and use it, ignoring the others
 * if there are multiple entries in the TLB for an address,
   throw them all out and do a page table walk to get a new one

QEMU's page table walk implementation for Arm CPUs already meets the
requirements for FEAT_BBM level 2. When we cache an entry in our TCG
TLB, we do so only for the specific (non-huge) page that the address
is in, and there is no way for the TLB data structure to ever have
more than one TLB entry for that page. (We handle huge pages only in
that we track what part of the address space is covered by huge pages
so that a TLB invalidate operation for an address in a huge page
results in an invalidation of the whole TLB.) We ignore the Contiguous
bit in page table entries, so we don't have to do anything for the
parts of FEAT_BBM that deal with changis to the Contiguous bit.

FEAT_BBM level 2 also requires that the nT bit in block descriptors
must be ignored; since commit 39a1fd25287f5dece5 we do this.

It's therefore safe for QEMU to advertise FEAT_BBM level 2 by
setting ID_AA64MMFR2_EL1.BBM to 2.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220426160422.2353158-3-peter.maydell@linaro.org
---
 docs/system/arm/emulation.rst | 1 +
 target/arm/cpu64.c            | 1 +
 2 files changed, 2 insertions(+)

diff --git a/docs/system/arm/emulation.rst b/docs/system/arm/emulation.rst
index XXXXXXX..XXXXXXX 100644
--- a/docs/system/arm/emulation.rst
+++ b/docs/system/arm/emulation.rst
@@ -XXX,XX +XXX,XX @@ the following architecture extensions:
 - FEAT_AA32HPD (AArch32 hierarchical permission disables)
 - FEAT_AA32I8MM (AArch32 Int8 matrix multiplication instructions)
 - FEAT_AES (AESD and AESE instructions)
+- FEAT_BBM at level 2 (Translation table break-before-make levels)
 - FEAT_BF16 (AArch64 BFloat16 instructions)
 - FEAT_BTI (Branch Target Identification)
 - FEAT_DIT (Data Independent Timing instructions)
diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu64.c
+++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
     t = FIELD_DP64(t, ID_AA64MMFR2, ST, 1); /* TTST */
     t = FIELD_DP64(t, ID_AA64MMFR2, VARANGE, 1); /* FEAT_LVA */
     t = FIELD_DP64(t, ID_AA64MMFR2, TTL, 1); /* FEAT_TTL */
+    t = FIELD_DP64(t, ID_AA64MMFR2, BBM, 2); /* FEAT_BBM at level 2 */
     cpu->isar.id_aa64mmfr2 = t;
 
     t = cpu->isar.id_aa64zfr0;
-- 
2.25.1

The Arm SMMUv3 includes an optional feature equivalent to the CPU
FEAT_BBM, which permits an OS to switch a range of memory between
"covered by a huge page" and "covered by a sequence of normal pages"
without having to engage in the traditional 'break-before-make'
dance. (This is particularly important for the SMMU, because devices
performing I/O through an SMMU are less likely to be able to cope with
the window in the sequence where an access results in a translation
fault.)  The SMMU spec explicitly notes that one of the valid ways to
be a BBM level 2 compliant implementation is:
 * if there are multiple entries in the TLB for an address,
   choose one of them and use it, ignoring the others

Our SMMU TLB implementation (unlike our CPU TLB) does allow multiple
TLB entries for an address, because the translation table level is
part of the SMMUIOTLBKey, and so our IOTLB hashtable can include
entries for the same address where the leaf was at different levels
(i.e. both hugepage and normal page). Our TLB lookup implementation in
smmu_iotlb_lookup() will always find the entry with the lowest level
(i.e. it prefers the hugepage over the normal page) and ignore any
others. TLB invalidation correctly removes all TLB entries matching
the specified address or address range (unless the guest specifies the
leaf level explicitly, in which case it gets what it asked for). So we
can validly advertise support for BBML level 2.

Note that we still can't yet advertise ourselves as an SMMU v3.2,
because v3.2 requires support for the S2FWB feature, which we don't
yet implement.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Eric Auger <eric.auger@redhat.com>
Message-id: 20220426160422.2353158-4-peter.maydell@linaro.org
---
 hw/arm/smmuv3-internal.h | 1 +
 hw/arm/smmuv3.c          | 1 +
 2 files changed, 2 insertions(+)

diff --git a/hw/arm/smmuv3-internal.h b/hw/arm/smmuv3-internal.h
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/smmuv3-internal.h
+++ b/hw/arm/smmuv3-internal.h
@@ -XXX,XX +XXX,XX @@ REG32(IDR2,                0x8)
 REG32(IDR3,                0xc)
      FIELD(IDR3, HAD,         2, 1);
      FIELD(IDR3, RIL,        10, 1);
+     FIELD(IDR3, BBML,       11, 2);
 REG32(IDR4,                0x10)
 REG32(IDR5,                0x14)
      FIELD(IDR5, OAS,         0, 3);
diff --git a/hw/arm/smmuv3.c b/hw/arm/smmuv3.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/smmuv3.c
+++ b/hw/arm/smmuv3.c
@@ -XXX,XX +XXX,XX @@ static void smmuv3_init_regs(SMMUv3State *s)
 
     s->idr[3] = FIELD_DP32(s->idr[3], IDR3, RIL, 1);
     s->idr[3] = FIELD_DP32(s->idr[3], IDR3, HAD, 1);
+    s->idr[3] = FIELD_DP32(s->idr[3], IDR3, BBML, 2);
 
     /* 4K, 16K and 64K granule support */
     s->idr[5] = FIELD_DP32(s->idr[5], IDR5, GRAN4K, 1);
-- 
2.25.1