Series comparison

-[Qemu-devel] [PULL 00/45] target-arm queue
+[PULL 000/117] target-arm queue
-As promised, another pullreq... This one's mostly RTH's patches.
+Massive pullreq but almost all of that is RTH's SVE
 refactoring patchset. The other interesting thing here is
 the fix for compiling on aarch64 macos.
 thanks
 -- PMM
-The following changes since commit 784c2e4f232adf5ef47a84a262ec72a07d068d6a:
+The following changes since commit f7a1ea403e0282a7f57edd4298c4f65f24165da5:
-  Merge remote-tracking branch 'remotes/jasowang/tags/net-pull-request' into staging (2018-10-19 15:30:40 +0100)
+  Merge tag 'misc-pull-request' of gitlab.com:marcandre.lureau/qemu into staging (2022-05-29 16:34:56 -0700)
 are available in the Git repository at:
-  https://git.linaro.org/people/pmaydell/qemu-arm.git tags/pull-target-arm-20181019
+  https://git.linaro.org/people/pmaydell/qemu-arm.git tags/pull-target-arm-20220530
-for you to fetch changes up to 88c9add25e7120e8622796c81ad3f3fb7f8d40e7:
+for you to fetch changes up to b1071174d2a2ab371082b7d4b5f19e98edc61ac6:
-  target/arm: Only flush tlb if ASID changes (2018-10-19 17:38:48 +0100)
+  target/arm: Remove aa64_sve check from before disas_sve (2022-05-30 17:05:12 +0100)
 ----------------------------------------------------------------
 target-arm queue:
- * ssi-sd: Make devices picking up backends unavailable with -device
+ * docs/system/arm: Add FEAT_HCX to list of emulated features
- * Add support for VCPU event states
+ * target/arm/hvf: Include missing "cpregs.h"
- * Move towards making ID registers the source of truth for
+ * hw/sd/allwinner-sdhost: report FIFO water level as 1 when data ready
-   whether a guest CPU implements a feature, rather than having
+ * SVE: refactor to use TRANS/TRANS_FEAT macros and push
-   parallel ID registers and feature bit flags
+   SVE feature check down to individual insn level
  * Implement various HCR hypervisor trap/config bits
  * Get IL bit correct for v7 syndrome values
  * Report correct syndrome for FP/SIMD traps to Hyp mode
  * hw/arm/boot: Increase compliance with kernel arm64 boot protocol
  * Refactor A32 Neon to use generic vector infrastructure
  * Fix a bug in A32 VLD2 "(multiple 2-element structures)" insn
  * net: cadence_gem: Report features correctly in ID register
  * Avoid some unnecessary TLB flushes on TTBR register writes
 ----------------------------------------------------------------
-Dongjiu Geng (1):
+Icenowy Zheng (1):
-      target/arm: Add support for VCPU event states
+      hw/sd/allwinner-sdhost: report FIFO water level as 1 when data ready
-Edgar E. Iglesias (2):
+Peter Maydell (1):
-      net: cadence_gem: Announce availability of priority queues
+      docs/system/arm: Add FEAT_HCX to list of emulated features
       net: cadence_gem: Announce 64bit addressing support
-Markus Armbruster (1):
+Philippe Mathieu-Daudé (1):
-      ssi-sd: Make devices picking up backends unavailable with -device
+      target/arm/hvf: Include missing "cpregs.h"
-Peter Maydell (10):
+Richard Henderson (114):
-      target/arm: Improve debug logging of AArch32 exception return
+      target/arm: Introduce TRANS, TRANS_FEAT
-      target/arm: Make switch_mode() file-local
+      target/arm: Move null function and sve check into gen_gvec_ool_zz
-      target/arm: Implement HCR.FB
+      target/arm: Use TRANS_FEAT for gen_gvec_ool_zz
-      target/arm: Implement HCR.DC
+      target/arm: Move null function and sve check into gen_gvec_ool_zzz
-      target/arm: ISR_EL1 bits track virtual interrupts if IMO/FMO set
+      target/arm: Introduce gen_gvec_ool_arg_zzz
-      target/arm: Implement HCR.VI and VF
+      target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zzz
-      target/arm: Implement HCR.PTW
+      target/arm: Use TRANS_FEAT for do_sve2_zzz_ool
-      target/arm: New utility function to extract EC from syndrome
+      target/arm: Move null function and sve check into gen_gvec_ool_zzzz
-      target/arm: Get IL bit correct for v7 syndrome values
+      target/arm: Use TRANS_FEAT for gen_gvec_ool_zzzz
-      target/arm: Report correct syndrome for FP/SIMD traps to Hyp mode
+      target/arm: Introduce gen_gvec_ool_arg_zzzz
       target/arm: Use TRANS_FEAT for do_sve2_zzzz_ool
       target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zzzz
       target/arm: Rename do_zzxz_ool to gen_gvec_ool_arg_zzxz
       target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zzxz
       target/arm: Use TRANS_FEAT for do_sve2_zzz_data
       target/arm: Use TRANS_FEAT for do_sve2_zzzz_data
       target/arm: Use TRANS_FEAT for do_sve2_zzw_data
       target/arm: Use TRANS_FEAT for USDOT_zzzz
       target/arm: Move null function and sve check into gen_gvec_ool_zzp
       target/arm: Introduce gen_gvec_ool_arg_zpz
       target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zpz
       target/arm: Use TRANS_FEAT for do_sve2_zpz_data
       target/arm: Rename do_zpzi_ool to gen_gvec_ool_arg_zpzi
       target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zpzi
       target/arm: Move null function and sve check into gen_gvec_ool_zzzp
       target/arm: Introduce gen_gvec_ool_arg_zpzz
       target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zpzz
       target/arm: Use TRANS_FEAT for do_sve2_zpzz_ool
       target/arm: Merge gen_gvec_fn_zz into do_mov_z
       target/arm: Move null function and sve check into gen_gvec_fn_zzz
       target/arm: Rename do_zzz_fn to gen_gvec_fn_arg_zzz
       target/arm: More use of gen_gvec_fn_arg_zzz
       target/arm: Use TRANS_FEAT for gen_gvec_fn_arg_zzz
       target/arm: Use TRANS_FEAT for do_sve2_fn_zzz
       target/arm: Use TRANS_FEAT for RAX1
       target/arm: Introduce gen_gvec_fn_arg_zzzz
       target/arm: Use TRANS_FEAT for do_sve2_zzzz_fn
       target/arm: Introduce gen_gvec_fn_zzi
       target/arm: Use TRANS_FEAT for do_zz_dbm
       target/arm: Hoist sve access check through do_sel_z
       target/arm: Introduce gen_gvec_fn_arg_zzi
       target/arm: Use TRANS_FEAT for do_sve2_fn2i
       target/arm: Use TRANS_FEAT for do_vpz_ool
       target/arm: Use TRANS_FEAT for do_shift_imm
       target/arm: Introduce do_shift_zpzi
       target/arm: Use TRANS_FEAT for do_shift_zpzi
       target/arm: Use TRANS_FEAT for do_zpzzz_ool
       target/arm: Move sve check into do_index
       target/arm: Use TRANS_FEAT for do_index
       target/arm: Use TRANS_FEAT for do_adr
       target/arm: Use TRANS_FEAT for do_predset
       target/arm: Use TRANS_FEAT for RDFFR, WRFFR
       target/arm: Use TRANS_FEAT for do_pfirst_pnext
       target/arm: Use TRANS_FEAT for do_EXT
       target/arm: Use TRANS_FEAT for do_perm_pred3
       target/arm: Use TRANS_FEAT for do_perm_pred2
       target/arm: Move sve zip high_ofs into simd_data
       target/arm: Use gen_gvec_ool_arg_zzz for do_zip, do_zip_q
       target/arm: Use TRANS_FEAT for do_zip, do_zip_q
       target/arm: Use TRANS_FEAT for do_clast_vector
       target/arm: Use TRANS_FEAT for do_clast_fp
       target/arm: Use TRANS_FEAT for do_clast_general
       target/arm: Use TRANS_FEAT for do_last_fp
       target/arm: Use TRANS_FEAT for do_last_general
       target/arm: Use TRANS_FEAT for SPLICE
       target/arm: Use TRANS_FEAT for do_ppzz_flags
       target/arm: Use TRANS_FEAT for do_sve2_ppzz_flags
       target/arm: Use TRANS_FEAT for do_ppzi_flags
       target/arm: Use TRANS_FEAT for do_brk2, do_brk3
       target/arm: Use TRANS_FEAT for MUL_zzi
       target/arm: Reject dup_i w/ shifted byte early
       target/arm: Reject add/sub w/ shifted byte early
       target/arm: Reject copy w/ shifted byte early
       target/arm: Use TRANS_FEAT for ADD_zzi
       target/arm: Use TRANS_FEAT for do_zzi_sat
       target/arm: Use TRANS_FEAT for do_zzi_ool
       target/arm: Introduce gen_gvec_{ptr,fpst}_zzzz
       target/arm: Use TRANS_FEAT for FMMLA
       target/arm: Move sve check into gen_gvec_fn_ppp
       target/arm: Implement NOT (prediates) alias
       target/arm: Use TRANS_FEAT for SEL_zpzz
       target/arm: Use TRANS_FEAT for MOVPRFX
       target/arm: Use TRANS_FEAT for FMLA
       target/arm: Use TRANS_FEAT for BFMLA
       target/arm: Rename do_zzz_fp to gen_gvec_ool_fpst_arg_zzz
       target/arm: Use TRANS_FEAT for DO_FP3
       target/arm: Use TRANS_FEAT for FMUL_zzx
       target/arm: Use TRANS_FEAT for FTMAD
       target/arm: Move null function and sve check into do_reduce
       target/arm: Use TRANS_FEAT for do_reduce
       target/arm: Use TRANS_FEAT for FRECPE, FRSQRTE
       target/arm: Expand frint_fns for MO_8
       target/arm: Rename do_zpz_ptr to gen_gvec_ool_fpst_arg_zpz
       target/arm: Move null function and sve check into do_frint_mode
       target/arm: Use TRANS_FEAT for do_frint_mode
       target/arm: Use TRANS_FEAT for FLOGB
       target/arm: Use TRANS_FEAT for do_ppz_fp
       target/arm: Rename do_zpzz_ptr to gen_gvec_fpst_arg_zpzz
       target/arm: Use TRANS_FEAT for gen_gvec_fpst_arg_zpzz
       target/arm: Use TRANS_FEAT for FCADD
       target/arm: Introduce gen_gvec_fpst_zzzzp
       target/arm: Use TRANS_FEAT for gen_gvec_fpst_zzzzp
       target/arm: Move null function and sve check into do_fp_imm
       target/arm: Use TRANS_FEAT for DO_FP_IMM
       target/arm: Use TRANS_FEAT for DO_FPCMP
       target/arm: Remove assert in trans_FCMLA_zzxz
       target/arm: Use TRANS_FEAT for FCMLA_zzxz
       target/arm: Use TRANS_FEAT for do_narrow_extract
       target/arm: Use TRANS_FEAT for do_shll_tb
       target/arm: Use TRANS_FEAT for do_shr_narrow
       target/arm: Use TRANS_FEAT for do_FMLAL_zzzw
       target/arm: Use TRANS_FEAT for do_FMLAL_zzxw
       target/arm: Add sve feature check for remaining trans_* functions
       target/arm: Remove aa64_sve check from before disas_sve
-Richard Henderson (30):
+ docs/system/arm/emulation.rst |    1 +
-      target/arm: Move some system registers into a substructure
+ target/arm/translate.h        |   11 +
-      target/arm: V8M should not imply V7VE
+ target/arm/sve.decode         |   57 +-
-      target/arm: Convert v8 extensions from feature bits to isar tests
+ hw/sd/allwinner-sdhost.c      |    7 +
-      target/arm: Convert division from feature bits to isar0 tests
+ target/arm/hvf/hvf.c          |    1 +
-      target/arm: Convert jazelle from feature bit to isar1 test
+ target/arm/sve_helper.c       |    6 +-
-      target/arm: Convert t32ee from feature bit to isar3 test
+ target/arm/translate-a64.c    |    2 +-
-      target/arm: Convert sve from feature bit to aa64pfr0 test
+ target/arm/translate-sve.c    | 5367 +++++++++++++++--------------------------
-      target/arm: Convert v8.2-fp16 from feature bit to aa64pfr0 test
+files changed, 2067 insertions(+), 3385 deletions(-)
       target/arm: Hoist address increment for vector memory ops
       target/arm: Don't call tcg_clear_temp_count
       target/arm: Use tcg_gen_gvec_dup_i64 for LD[1-4]R
       target/arm: Promote consecutive memory ops for aa64
       target/arm: Mark some arrays const
       target/arm: Use gvec for NEON VDUP
       target/arm: Use gvec for NEON VMOV, VMVN, VBIC & VORR (immediate)
       target/arm: Use gvec for NEON_3R_LOGIC insns
       target/arm: Use gvec for NEON_3R_VADD_VSUB insns
       target/arm: Use gvec for NEON_2RM_VMN, NEON_2RM_VNEG
       target/arm: Use gvec for NEON_3R_VMUL
       target/arm: Use gvec for VSHR, VSHL
       target/arm: Use gvec for VSRA
       target/arm: Use gvec for VSRI, VSLI
       target/arm: Use gvec for NEON_3R_VML
       target/arm: Use gvec for NEON_3R_VTST_VCEQ, NEON_3R_VCGT, NEON_3R_VCGE
       target/arm: Use gvec for NEON VLD all lanes
       target/arm: Reorg NEON VLD/VST all elements
       target/arm: Promote consecutive memory ops for aa32
       target/arm: Reorg NEON VLD/VST single element to one lane
       target/arm: Remove writefn from TTBR0_EL3
       target/arm: Only flush tlb if ASID changes
-Stewart Hildebrand (1):
-      hw/arm/boot: Increase compliance with kernel arm64 boot protocol
- target/arm/cpu.h            |  227 ++++++-
- target/arm/internals.h      |   45 +-
- target/arm/kvm_arm.h        |   24 +
- target/arm/translate.h      |   21 +
- hw/arm/boot.c               |   18 +
- hw/intc/armv7m_nvic.c       |   12 +-
- hw/net/cadence_gem.c        |    9 +-
- hw/sd/ssi-sd.c              |    2 +
- linux-user/aarch64/signal.c |    4 +-
- linux-user/elfload.c        |   60 +-
- linux-user/syscall.c        |   10 +-
- target/arm/cpu.c            |  242 ++++----
- target/arm/cpu64.c          |  148 +++--
- target/arm/helper.c         |  397 ++++++++----
- target/arm/kvm.c            |   60 ++
- target/arm/kvm32.c          |   13 +
- target/arm/kvm64.c          |   15 +-
- target/arm/machine.c        |   28 +-
- target/arm/op_helper.c      |    2 +-
- target/arm/translate-a64.c  |  715 ++++-----------------
- target/arm/translate.c      | 1451 ++++++++++++++++++++++++++++---------------
-files changed, 2021 insertions(+), 1482 deletions(-)

-[Qemu-devel] [PULL 17/45] target/arm: Implement HCR.PTW
+[PULL 001/117] docs/system/arm: Add FEAT_HCX to list of emulated features
-If the HCR_EL2 PTW virtualizaiton configuration register bit
+In commit 5814d587fe861fe9 we added support for emulating
-is set, then this means that a stage 2 Permission fault must
+FEAT_HCX (Support for the HCRX_EL2 register). However we
-be generated if a stage 1 translation table access is made
+forgot to add it to the list in emulated.rst. Correct the
-to an address that is mapped as Device memory in stage 2.
+omission.
 Implement this.
+Fixes: 5814d587fe861fe9 ("target/arm: Enable FEAT_HCX for -cpu max")
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181012144235.19646-8-peter.maydell@linaro.org
+Message-id: 20220520084320.424166-1-peter.maydell@linaro.org
 ---
- target/arm/helper.c | 21 ++++++++++++++++++++-
+ docs/system/arm/emulation.rst | 1 +
-file changed, 20 insertions(+), 1 deletion(-)
+file changed, 1 insertion(+)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+diff --git a/docs/system/arm/emulation.rst b/docs/system/arm/emulation.rst
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/docs/system/arm/emulation.rst
-+++ b/target/arm/helper.c
++++ b/docs/system/arm/emulation.rst
-@@ -XXX,XX +XXX,XX @@ static hwaddr S1_ptw_translate(CPUARMState *env, ARMMMUIdx mmu_idx,
+@@ -XXX,XX +XXX,XX @@ the following architecture extensions:
-         hwaddr s2pa;
+ - FEAT_FRINTTS (Floating-point to integer instructions)
-         int s2prot;
+ - FEAT_FlagM (Flag manipulation instructions v2)
-         int ret;
+ - FEAT_FlagM2 (Enhancements to flag manipulation instructions)
-+        ARMCacheAttrs cacheattrs = {};
++- FEAT_HCX (Support for the HCRX_EL2 register)
-+        ARMCacheAttrs *pcacheattrs = NULL;
+ - FEAT_HPDS (Hierarchical permission disables)
-+
+ - FEAT_I8MM (AArch64 Int8 matrix multiplication instructions)
-+        if (env->cp15.hcr_el2 & HCR_PTW) {
+ - FEAT_IDST (ID space trap handling)
 +            /*
 +             * PTW means we must fault if this S1 walk touches S2 Device
 +             * memory; otherwise we don't care about the attributes and can
 +             * save the S2 translation the effort of computing them.
 +             */
 +            pcacheattrs = &cacheattrs;
 +        }
          ret = get_phys_addr_lpae(env, addr, 0, ARMMMUIdx_S2NS, &s2pa,
 -                                 &txattrs, &s2prot, &s2size, fi, NULL);
 +                                 &txattrs, &s2prot, &s2size, fi, pcacheattrs);
          if (ret) {
              assert(fi->type != ARMFault_None);
              fi->s2addr = addr;
@@ -XXX,XX +XXX,XX @@ static hwaddr S1_ptw_translate(CPUARMState *env, ARMMMUIdx mmu_idx,
              fi->s1ptw = true;
              return ~0;
          }
 +        if (pcacheattrs && (pcacheattrs->attrs & 0xf0) == 0) {
 +            /* Access was to Device memory: generate Permission fault */
 +            fi->type = ARMFault_Permission;
 +            fi->s2addr = addr;
 +            fi->stage2 = true;
 +            fi->s1ptw = true;
 +            return ~0;
 +        }
          addr = s2pa;
      }
      return addr;
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 19/45] target/arm: Get IL bit correct for v7 syndrome values
+[PULL 002/117] target/arm/hvf: Include missing "cpregs.h"
-For the v7 version of the Arm architecture, the IL bit in
+From: Philippe Mathieu-Daudé <f4bug@amsat.org>
 syndrome register values where the field is not valid was
 defined to be UNK/SBZP. In v8 this is RES1, which is what
 QEMU currently implements. Handle the desired v7 behaviour
 by squashing the IL bit for the affected cases:
  * EC == EC_UNCATEGORIZED
  * prefetch aborts
  * data aborts where ISV is 0
-(The fourth case listed in the v8 Arm ARM DDI 0487C.a in
+Fix when building HVF on macOS Aarch64:
 section G7.2.70, "illegal state exception", can't happen
 on a v7 CPU.)
-This deals with a corner case noted in a comment.
+  target/arm/hvf/hvf.c:586:15: error: unknown type name 'ARMCPRegInfo'; did you mean 'ARMCPUInfo'?
           const ARMCPRegInfo *ri;
                 ^~~~~~~~~~~~
                 ARMCPUInfo
   target/arm/cpu-qom.h:38:3: note: 'ARMCPUInfo' declared here
   } ARMCPUInfo;
     ^
   target/arm/hvf/hvf.c:589:14: error: implicit declaration of function 'get_arm_cp_reginfo' is invalid in C99 [-Werror,-Wimplicit-function-declaration]
           ri = get_arm_cp_reginfo(arm_cpu->cp_regs, key);
                ^
   target/arm/hvf/hvf.c:589:12: warning: incompatible integer to pointer conversion assigning to 'const ARMCPUInfo *' (aka 'const struct ARMCPUInfo *') from 'int' [-Wint-conversion]
           ri = get_arm_cp_reginfo(arm_cpu->cp_regs, key);
              ^ ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~
   target/arm/hvf/hvf.c:591:26: error: no member named 'type' in 'struct ARMCPUInfo'
               assert(!(ri->type & ARM_CP_NO_RAW));
                        ~~  ^
   /Library/Developer/CommandLineTools/SDKs/MacOSX.sdk/usr/include/assert.h:99:25: note: expanded from macro 'assert'
       (__builtin_expect(!(e), 0) ? __assert_rtn(__func__, __ASSERT_FILE_NAME, __LINE__, #e) : (void)0)
                           ^
   target/arm/hvf/hvf.c:591:33: error: use of undeclared identifier 'ARM_CP_NO_RAW'
               assert(!(ri->type & ARM_CP_NO_RAW));
                                   ^
 warning and 4 errors generated.
+Fixes: cf7c6d1004 ("target/arm: Split out cpregs.h")
+Reported-by: Duncan Bayne <duncan@bayne.id.au>
+Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220525161926.34233-1-philmd@fungible.com
+Resolves: https://gitlab.com/qemu-project/qemu/-/issues/1029
+Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181012144235.19646-10-peter.maydell@linaro.org
 ---
- target/arm/internals.h |  7 ++-----
+ target/arm/hvf/hvf.c | 1 +
- target/arm/helper.c    | 13 +++++++++++++
+file changed, 1 insertion(+)
 files changed, 15 insertions(+), 5 deletions(-)
-diff --git a/target/arm/internals.h b/target/arm/internals.h
+diff --git a/target/arm/hvf/hvf.c b/target/arm/hvf/hvf.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/internals.h
+--- a/target/arm/hvf/hvf.c
-+++ b/target/arm/internals.h
++++ b/target/arm/hvf/hvf.c
-@@ -XXX,XX +XXX,XX @@ static inline uint32_t syn_get_ec(uint32_t syn)
+@@ -XXX,XX +XXX,XX @@
- /* Utility functions for constructing various kinds of syndrome value.
+ #include "sysemu/hvf_int.h"
-  * Note that in general we follow the AArch64 syndrome values; in a
+ #include "sysemu/hw_accel.h"
-  * few cases the value in HSR for exceptions taken to AArch32 Hyp
+ #include "hvf_arm.h"
-- * mode differs slightly, so if we ever implemented Hyp mode then the
++#include "cpregs.h"
-- * syndrome value would need some massaging on exception entry.
-- * (One example of this is that AArch64 defaults to IL bit set for
+ #include <mach/mach_time.h>
 - * exceptions which don't specifically indicate information about the
 - * trapping instruction, whereas AArch32 defaults to IL bit clear.)
 + * mode differs slightly, and we fix this up when populating HSR in
 + * arm_cpu_do_interrupt_aarch32_hyp().
   */
  static inline uint32_t syn_uncategorized(void)
  {
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_do_interrupt_aarch32_hyp(CPUState *cs)
      }
      if (cs->exception_index != EXCP_IRQ && cs->exception_index != EXCP_FIQ) {
 +        if (!arm_feature(env, ARM_FEATURE_V8)) {
 +            /*
 +             * QEMU syndrome values are v8-style. v7 has the IL bit
 +             * UNK/SBZP for "field not valid" cases, where v8 uses RES1.
 +             * If this is a v7 CPU, squash the IL bit in those cases.
 +             */
 +            if (cs->exception_index == EXCP_PREFETCH_ABORT ||
 +                (cs->exception_index == EXCP_DATA_ABORT &&
 +                 !(env->exception.syndrome & ARM_EL_ISV)) ||
 +                syn_get_ec(env->exception.syndrome) == EC_UNCATEGORIZED) {
 +                env->exception.syndrome &= ~ARM_EL_IL;
 +            }
 +        }
          env->cp15.esr_el[2] = env->exception.syndrome;
      }
 --
-.19.1
+.25.1

-New patch
+[PULL 003/117] hw/sd/allwinner-sdhost: report FIFO water level as 1 when data ready
+From: Icenowy Zheng <uwu@icenowy.me>
+U-Boot queries the FIFO water level to reduce checking status register
+when doing PIO SD card operation.
+Report a FIFO water level of 1 when data is ready, to prevent the code
+from trying to read 0 words from the FIFO each time.
+Signed-off-by: Icenowy Zheng <uwu@icenowy.me>
+Message-id: 20220520124200.2112699-1-uwu@icenowy.me
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ hw/sd/allwinner-sdhost.c | 7 +++++++
+file changed, 7 insertions(+)
+diff --git a/hw/sd/allwinner-sdhost.c b/hw/sd/allwinner-sdhost.c
+index XXXXXXX..XXXXXXX 100644
+--- a/hw/sd/allwinner-sdhost.c
++++ b/hw/sd/allwinner-sdhost.c
+@@ -XXX,XX +XXX,XX @@ enum {
+ };
+ enum {
++    SD_STAR_FIFO_EMPTY      = (1 << 2),
+     SD_STAR_CARD_PRESENT    = (1 << 8),
++    SD_STAR_FIFO_LEVEL_1    = (1 << 17),
+ };
+ enum {
+@@ -XXX,XX +XXX,XX @@ static uint64_t allwinner_sdhost_read(void *opaque, hwaddr offset,
+         break;
+     case REG_SD_STAR:      /* Status */
+         res = s->status;
++        if (sdbus_data_ready(&s->sdbus)) {
++            res |= SD_STAR_FIFO_LEVEL_1;
++        } else {
++            res |= SD_STAR_FIFO_EMPTY;
++        }
+         break;
+     case REG_SD_FWLR:      /* FIFO Water Level */
+         res = s->fifo_wlevel;
+--
+.25.1

-[Qemu-devel] [PULL 05/45] target/arm: Convert v8 extensions from feature bits to isar tests
+[PULL 004/117] target/arm: Introduce TRANS, TRANS_FEAT
 From: Richard Henderson <richard.henderson@linaro.org>
-Most of the v8 extensions are self-contained within the ISAR
+Steal the idea for these leaf function expanders from PowerPC.
 registers and are not implied by other feature bits, which
 makes them the easiest to convert.
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181016223115.24100-4-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-2-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.h           | 131 +++++++++++++++++++++++++++++++++----
+ target/arm/translate.h | 11 +++++++++++
- target/arm/translate.h     |   7 ++
+file changed, 11 insertions(+)
  linux-user/elfload.c       |  46 ++++++++-----
  target/arm/cpu.c           |  27 +++++---
  target/arm/cpu64.c         |  57 +++++++++-------
  target/arm/translate-a64.c | 101 ++++++++++++++--------------
  target/arm/translate.c     |  36 +++++-----
 files changed, 273 insertions(+), 132 deletions(-)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
-+++ b/target/arm/cpu.h
-@@ -XXX,XX +XXX,XX @@ typedef enum ARMPSCIState {
-     PSCI_ON_PENDING = 2
- } ARMPSCIState;
-+typedef struct ARMISARegisters ARMISARegisters;
-+
- /**
-  * ARMCPU:
-  * @env: #CPUARMState
-@@ -XXX,XX +XXX,XX @@ enum arm_features {
-     ARM_FEATURE_LPAE, /* has Large Physical Address Extension */
-     ARM_FEATURE_V8,
-     ARM_FEATURE_AARCH64, /* supports 64 bit mode */
--    ARM_FEATURE_V8_AES, /* implements AES part of v8 Crypto Extensions */
-     ARM_FEATURE_CBAR, /* has cp15 CBAR */
-     ARM_FEATURE_CRC, /* ARMv8 CRC instructions */
-     ARM_FEATURE_CBAR_RO, /* has cp15 CBAR and it is read-only */
-     ARM_FEATURE_EL2, /* has EL2 Virtualization support */
-     ARM_FEATURE_EL3, /* has EL3 Secure monitor support */
--    ARM_FEATURE_V8_SHA1, /* implements SHA1 part of v8 Crypto Extensions */
--    ARM_FEATURE_V8_SHA256, /* implements SHA256 part of v8 Crypto Extensions */
--    ARM_FEATURE_V8_PMULL, /* implements PMULL part of v8 Crypto Extensions */
-     ARM_FEATURE_THUMB_DSP, /* DSP insns supported in the Thumb encodings */
-     ARM_FEATURE_PMU, /* has PMU support */
-     ARM_FEATURE_VBAR, /* has cp15 VBAR */
-     ARM_FEATURE_M_SECURITY, /* M profile Security Extension */
-     ARM_FEATURE_JAZELLE, /* has (trivial) Jazelle implementation */
-     ARM_FEATURE_SVE, /* has Scalable Vector Extension */
--    ARM_FEATURE_V8_SHA512, /* implements SHA512 part of v8 Crypto Extensions */
--    ARM_FEATURE_V8_SHA3, /* implements SHA3 part of v8 Crypto Extensions */
--    ARM_FEATURE_V8_SM3, /* implements SM3 part of v8 Crypto Extensions */
--    ARM_FEATURE_V8_SM4, /* implements SM4 part of v8 Crypto Extensions */
--    ARM_FEATURE_V8_ATOMICS, /* ARMv8.1-Atomics feature */
--    ARM_FEATURE_V8_RDM, /* implements v8.1 simd round multiply */
--    ARM_FEATURE_V8_DOTPROD, /* implements v8.2 simd dot product */
-     ARM_FEATURE_V8_FP16, /* implements v8.2 half-precision float */
--    ARM_FEATURE_V8_FCMA, /* has complex number part of v8.3 extensions.  */
-     ARM_FEATURE_M_MAIN, /* M profile Main Extension */
- };
-@@ -XXX,XX +XXX,XX @@ static inline uint64_t *aa64_vfp_qreg(CPUARMState *env, unsigned regno)
- /* Shared between translate-sve.c and sve_helper.c.  */
- extern const uint64_t pred_esz_masks[4];
-+/*
-+ * 32-bit feature tests via id registers.
-+ */
-+static inline bool isar_feature_aa32_aes(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) != 0;
-+}
-+
-+static inline bool isar_feature_aa32_pmull(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) > 1;
-+}
-+
-+static inline bool isar_feature_aa32_sha1(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar5, ID_ISAR5, SHA1) != 0;
-+}
-+
-+static inline bool isar_feature_aa32_sha2(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar5, ID_ISAR5, SHA2) != 0;
-+}
-+
-+static inline bool isar_feature_aa32_crc32(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar5, ID_ISAR5, CRC32) != 0;
-+}
-+
-+static inline bool isar_feature_aa32_rdm(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar5, ID_ISAR5, RDM) != 0;
-+}
-+
-+static inline bool isar_feature_aa32_vcma(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar5, ID_ISAR5, VCMA) != 0;
-+}
-+
-+static inline bool isar_feature_aa32_dp(const ARMISARegisters *id)
-+{
-+    return FIELD_EX32(id->id_isar6, ID_ISAR6, DP) != 0;
-+}
-+
-+/*
-+ * 64-bit feature tests via id registers.
-+ */
-+static inline bool isar_feature_aa64_aes(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, AES) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_pmull(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, AES) > 1;
-+}
-+
-+static inline bool isar_feature_aa64_sha1(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SHA1) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_sha256(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SHA2) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_sha512(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SHA2) > 1;
-+}
-+
-+static inline bool isar_feature_aa64_crc32(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, CRC32) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_atomics(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, ATOMIC) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_rdm(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, RDM) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_sha3(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SHA3) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_sm3(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SM3) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_sm4(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SM4) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_dp(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, DP) != 0;
-+}
-+
-+static inline bool isar_feature_aa64_fcma(const ARMISARegisters *id)
-+{
-+    return FIELD_EX64(id->id_aa64isar1, ID_AA64ISAR1, FCMA) != 0;
-+}
-+
-+/*
-+ * Forward to the above feature tests given an ARMCPU pointer.
-+ */
-+#define cpu_isar_feature(name, cpu) \
-+    ({ ARMCPU *cpu_ = (cpu); isar_feature_##name(&cpu_->isar); })
-+
- #endif
 diff --git a/target/arm/translate.h b/target/arm/translate.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.h
 +++ b/target/arm/translate.h
-@@ -XXX,XX +XXX,XX @@
+@@ -XXX,XX +XXX,XX @@ static inline MemOp finalize_memop(DisasContext *s, MemOp opc)
- /* internal defines */
+  */
- typedef struct DisasContext {
+ uint64_t asimd_imm_const(uint32_t imm, int cmode, int op);
      DisasContextBase base;
 +    const ARMISARegisters *isar;
      target_ulong pc;
      target_ulong page_start;
@@ -XXX,XX +XXX,XX @@ static inline TCGv_i32 get_ahp_flag(void)
      return ret;
  }
 +/*
-+ * Forward to the isar_feature_* tests given a DisasContext pointer.
++ * Helpers for implementing sets of trans_* functions.
 + * Defer the implementation of NAME to FUNC, with optional extra arguments.
 + */
-+#define dc_isar_feature(name, ctx) \
++#define TRANS(NAME, FUNC, ...) \
-+    ({ DisasContext *ctx_ = (ctx); isar_feature_##name(ctx_->isar); })
++    static bool trans_##NAME(DisasContext *s, arg_##NAME *a) \
 +    { return FUNC(s, __VA_ARGS__); }
 +#define TRANS_FEAT(NAME, FEAT, FUNC, ...) \
 +    static bool trans_##NAME(DisasContext *s, arg_##NAME *a) \
 +    { return dc_isar_feature(FEAT, s) && FUNC(s, __VA_ARGS__); }
 +
  #endif /* TARGET_ARM_TRANSLATE_H */
-diff --git a/linux-user/elfload.c b/linux-user/elfload.c
-index XXXXXXX..XXXXXXX 100644
---- a/linux-user/elfload.c
-+++ b/linux-user/elfload.c
-@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
-     /* probe for the extra features */
- #define GET_FEATURE(feat, hwcap) \
-     do { if (arm_feature(&cpu->env, feat)) { hwcaps |= hwcap; } } while (0)
-+
-+#define GET_FEATURE_ID(feat, hwcap) \
-+    do { if (cpu_isar_feature(feat, cpu)) { hwcaps |= hwcap; } } while (0)
-+
-     /* EDSP is in v5TE and above, but all our v5 CPUs are v5TE */
-     GET_FEATURE(ARM_FEATURE_V5, ARM_HWCAP_ARM_EDSP);
-     GET_FEATURE(ARM_FEATURE_VFP, ARM_HWCAP_ARM_VFP);
-@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap2(void)
-     ARMCPU *cpu = ARM_CPU(thread_cpu);
-     uint32_t hwcaps = 0;
--    GET_FEATURE(ARM_FEATURE_V8_AES, ARM_HWCAP2_ARM_AES);
--    GET_FEATURE(ARM_FEATURE_V8_PMULL, ARM_HWCAP2_ARM_PMULL);
--    GET_FEATURE(ARM_FEATURE_V8_SHA1, ARM_HWCAP2_ARM_SHA1);
--    GET_FEATURE(ARM_FEATURE_V8_SHA256, ARM_HWCAP2_ARM_SHA2);
--    GET_FEATURE(ARM_FEATURE_CRC, ARM_HWCAP2_ARM_CRC32);
-+    GET_FEATURE_ID(aa32_aes, ARM_HWCAP2_ARM_AES);
-+    GET_FEATURE_ID(aa32_pmull, ARM_HWCAP2_ARM_PMULL);
-+    GET_FEATURE_ID(aa32_sha1, ARM_HWCAP2_ARM_SHA1);
-+    GET_FEATURE_ID(aa32_sha2, ARM_HWCAP2_ARM_SHA2);
-+    GET_FEATURE_ID(aa32_crc32, ARM_HWCAP2_ARM_CRC32);
-     return hwcaps;
- }
- #undef GET_FEATURE
-+#undef GET_FEATURE_ID
- #else
- /* 64 bit ARM definitions */
-@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
-     /* probe for the extra features */
- #define GET_FEATURE(feat, hwcap) \
-     do { if (arm_feature(&cpu->env, feat)) { hwcaps |= hwcap; } } while (0)
--    GET_FEATURE(ARM_FEATURE_V8_AES, ARM_HWCAP_A64_AES);
--    GET_FEATURE(ARM_FEATURE_V8_PMULL, ARM_HWCAP_A64_PMULL);
--    GET_FEATURE(ARM_FEATURE_V8_SHA1, ARM_HWCAP_A64_SHA1);
--    GET_FEATURE(ARM_FEATURE_V8_SHA256, ARM_HWCAP_A64_SHA2);
--    GET_FEATURE(ARM_FEATURE_CRC, ARM_HWCAP_A64_CRC32);
--    GET_FEATURE(ARM_FEATURE_V8_SHA3, ARM_HWCAP_A64_SHA3);
--    GET_FEATURE(ARM_FEATURE_V8_SM3, ARM_HWCAP_A64_SM3);
--    GET_FEATURE(ARM_FEATURE_V8_SM4, ARM_HWCAP_A64_SM4);
--    GET_FEATURE(ARM_FEATURE_V8_SHA512, ARM_HWCAP_A64_SHA512);
-+#define GET_FEATURE_ID(feat, hwcap) \
-+    do { if (cpu_isar_feature(feat, cpu)) { hwcaps |= hwcap; } } while (0)
-+
-+    GET_FEATURE_ID(aa64_aes, ARM_HWCAP_A64_AES);
-+    GET_FEATURE_ID(aa64_pmull, ARM_HWCAP_A64_PMULL);
-+    GET_FEATURE_ID(aa64_sha1, ARM_HWCAP_A64_SHA1);
-+    GET_FEATURE_ID(aa64_sha256, ARM_HWCAP_A64_SHA2);
-+    GET_FEATURE_ID(aa64_sha512, ARM_HWCAP_A64_SHA512);
-+    GET_FEATURE_ID(aa64_crc32, ARM_HWCAP_A64_CRC32);
-+    GET_FEATURE_ID(aa64_sha3, ARM_HWCAP_A64_SHA3);
-+    GET_FEATURE_ID(aa64_sm3, ARM_HWCAP_A64_SM3);
-+    GET_FEATURE_ID(aa64_sm4, ARM_HWCAP_A64_SM4);
-     GET_FEATURE(ARM_FEATURE_V8_FP16,
-                 ARM_HWCAP_A64_FPHP | ARM_HWCAP_A64_ASIMDHP);
--    GET_FEATURE(ARM_FEATURE_V8_ATOMICS, ARM_HWCAP_A64_ATOMICS);
--    GET_FEATURE(ARM_FEATURE_V8_RDM, ARM_HWCAP_A64_ASIMDRDM);
--    GET_FEATURE(ARM_FEATURE_V8_DOTPROD, ARM_HWCAP_A64_ASIMDDP);
--    GET_FEATURE(ARM_FEATURE_V8_FCMA, ARM_HWCAP_A64_FCMA);
-+    GET_FEATURE_ID(aa64_atomics, ARM_HWCAP_A64_ATOMICS);
-+    GET_FEATURE_ID(aa64_rdm, ARM_HWCAP_A64_ASIMDRDM);
-+    GET_FEATURE_ID(aa64_dp, ARM_HWCAP_A64_ASIMDDP);
-+    GET_FEATURE_ID(aa64_fcma, ARM_HWCAP_A64_FCMA);
-     GET_FEATURE(ARM_FEATURE_SVE, ARM_HWCAP_A64_SVE);
-+
- #undef GET_FEATURE
-+#undef GET_FEATURE_ID
-     return hwcaps;
- }
-diff --git a/target/arm/cpu.c b/target/arm/cpu.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.c
-+++ b/target/arm/cpu.c
-@@ -XXX,XX +XXX,XX @@ static void arm_max_initfn(Object *obj)
-         cortex_a15_initfn(obj);
- #ifdef CONFIG_USER_ONLY
-         /* We don't set these in system emulation mode for the moment,
--         * since we don't correctly set the ID registers to advertise them,
-+         * since we don't correctly set (all of) the ID registers to
-+         * advertise them.
-          */
-         set_feature(&cpu->env, ARM_FEATURE_V8);
--        set_feature(&cpu->env, ARM_FEATURE_V8_AES);
--        set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
--        set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
--        set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
--        set_feature(&cpu->env, ARM_FEATURE_CRC);
--        set_feature(&cpu->env, ARM_FEATURE_V8_RDM);
--        set_feature(&cpu->env, ARM_FEATURE_V8_DOTPROD);
--        set_feature(&cpu->env, ARM_FEATURE_V8_FCMA);
-+        {
-+            uint32_t t;
-+
-+            t = cpu->isar.id_isar5;
-+            t = FIELD_DP32(t, ID_ISAR5, AES, 2);
-+            t = FIELD_DP32(t, ID_ISAR5, SHA1, 1);
-+            t = FIELD_DP32(t, ID_ISAR5, SHA2, 1);
-+            t = FIELD_DP32(t, ID_ISAR5, CRC32, 1);
-+            t = FIELD_DP32(t, ID_ISAR5, RDM, 1);
-+            t = FIELD_DP32(t, ID_ISAR5, VCMA, 1);
-+            cpu->isar.id_isar5 = t;
-+
-+            t = cpu->isar.id_isar6;
-+            t = FIELD_DP32(t, ID_ISAR6, DP, 1);
-+            cpu->isar.id_isar6 = t;
-+        }
- #endif
-     }
- }
-diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu64.c
-+++ b/target/arm/cpu64.c
-@@ -XXX,XX +XXX,XX @@ static void aarch64_a57_initfn(Object *obj)
-     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
-     set_feature(&cpu->env, ARM_FEATURE_AARCH64);
-     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
--    set_feature(&cpu->env, ARM_FEATURE_V8_AES);
--    set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
--    set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
--    set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
--    set_feature(&cpu->env, ARM_FEATURE_CRC);
-     set_feature(&cpu->env, ARM_FEATURE_EL2);
-     set_feature(&cpu->env, ARM_FEATURE_EL3);
-     set_feature(&cpu->env, ARM_FEATURE_PMU);
-@@ -XXX,XX +XXX,XX @@ static void aarch64_a53_initfn(Object *obj)
-     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
-     set_feature(&cpu->env, ARM_FEATURE_AARCH64);
-     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
--    set_feature(&cpu->env, ARM_FEATURE_V8_AES);
--    set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
--    set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
--    set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
--    set_feature(&cpu->env, ARM_FEATURE_CRC);
-     set_feature(&cpu->env, ARM_FEATURE_EL2);
-     set_feature(&cpu->env, ARM_FEATURE_EL3);
-     set_feature(&cpu->env, ARM_FEATURE_PMU);
-@@ -XXX,XX +XXX,XX @@ static void aarch64_a72_initfn(Object *obj)
-     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
-     set_feature(&cpu->env, ARM_FEATURE_AARCH64);
-     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
--    set_feature(&cpu->env, ARM_FEATURE_V8_AES);
--    set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
--    set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
--    set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
--    set_feature(&cpu->env, ARM_FEATURE_CRC);
-     set_feature(&cpu->env, ARM_FEATURE_EL2);
-     set_feature(&cpu->env, ARM_FEATURE_EL3);
-     set_feature(&cpu->env, ARM_FEATURE_PMU);
-@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
-     if (kvm_enabled()) {
-         kvm_arm_set_cpu_features_from_host(cpu);
-     } else {
-+        uint64_t t;
-+        uint32_t u;
-         aarch64_a57_initfn(obj);
-+
-+        t = cpu->isar.id_aa64isar0;
-+        t = FIELD_DP64(t, ID_AA64ISAR0, AES, 2); /* AES + PMULL */
-+        t = FIELD_DP64(t, ID_AA64ISAR0, SHA1, 1);
-+        t = FIELD_DP64(t, ID_AA64ISAR0, SHA2, 2); /* SHA512 */
-+        t = FIELD_DP64(t, ID_AA64ISAR0, CRC32, 1);
-+        t = FIELD_DP64(t, ID_AA64ISAR0, ATOMIC, 2);
-+        t = FIELD_DP64(t, ID_AA64ISAR0, RDM, 1);
-+        t = FIELD_DP64(t, ID_AA64ISAR0, SHA3, 1);
-+        t = FIELD_DP64(t, ID_AA64ISAR0, SM3, 1);
-+        t = FIELD_DP64(t, ID_AA64ISAR0, SM4, 1);
-+        t = FIELD_DP64(t, ID_AA64ISAR0, DP, 1);
-+        cpu->isar.id_aa64isar0 = t;
-+
-+        t = cpu->isar.id_aa64isar1;
-+        t = FIELD_DP64(t, ID_AA64ISAR1, FCMA, 1);
-+        cpu->isar.id_aa64isar1 = t;
-+
-+        /* Replicate the same data to the 32-bit id registers.  */
-+        u = cpu->isar.id_isar5;
-+        u = FIELD_DP32(u, ID_ISAR5, AES, 2); /* AES + PMULL */
-+        u = FIELD_DP32(u, ID_ISAR5, SHA1, 1);
-+        u = FIELD_DP32(u, ID_ISAR5, SHA2, 1);
-+        u = FIELD_DP32(u, ID_ISAR5, CRC32, 1);
-+        u = FIELD_DP32(u, ID_ISAR5, RDM, 1);
-+        u = FIELD_DP32(u, ID_ISAR5, VCMA, 1);
-+        cpu->isar.id_isar5 = u;
-+
-+        u = cpu->isar.id_isar6;
-+        u = FIELD_DP32(u, ID_ISAR6, DP, 1);
-+        cpu->isar.id_isar6 = u;
-+
- #ifdef CONFIG_USER_ONLY
-         /* We don't set these in system emulation mode for the moment,
-          * since we don't correctly set the ID registers to advertise them,
-@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
-          * whereas the architecture requires them to be present in both if
-          * present in either.
-          */
--        set_feature(&cpu->env, ARM_FEATURE_V8_SHA512);
--        set_feature(&cpu->env, ARM_FEATURE_V8_SHA3);
--        set_feature(&cpu->env, ARM_FEATURE_V8_SM3);
--        set_feature(&cpu->env, ARM_FEATURE_V8_SM4);
--        set_feature(&cpu->env, ARM_FEATURE_V8_ATOMICS);
--        set_feature(&cpu->env, ARM_FEATURE_V8_RDM);
--        set_feature(&cpu->env, ARM_FEATURE_V8_DOTPROD);
-         set_feature(&cpu->env, ARM_FEATURE_V8_FP16);
--        set_feature(&cpu->env, ARM_FEATURE_V8_FCMA);
-         set_feature(&cpu->env, ARM_FEATURE_SVE);
-         /* For usermode -cpu max we can use a larger and more efficient DCZ
-          * blocksize since we don't have to follow what the hardware does.
-diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-a64.c
-+++ b/target/arm/translate-a64.c
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
-         }
-         if (rt2 == 31
-             && ((rt | rs) & 1) == 0
--            && arm_dc_feature(s, ARM_FEATURE_V8_ATOMICS)) {
-+            && dc_isar_feature(aa64_atomics, s)) {
-             /* CASP / CASPL */
-             gen_compare_and_swap_pair(s, rs, rt, rn, size | 2);
-             return;
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
-         }
-         if (rt2 == 31
-             && ((rt | rs) & 1) == 0
--            && arm_dc_feature(s, ARM_FEATURE_V8_ATOMICS)) {
-+            && dc_isar_feature(aa64_atomics, s)) {
-             /* CASPA / CASPAL */
-             gen_compare_and_swap_pair(s, rs, rt, rn, size | 2);
-             return;
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
-     case 0xb: /* CASL */
-     case 0xe: /* CASA */
-     case 0xf: /* CASAL */
--        if (rt2 == 31 && arm_dc_feature(s, ARM_FEATURE_V8_ATOMICS)) {
-+        if (rt2 == 31 && dc_isar_feature(aa64_atomics, s)) {
-             gen_compare_and_swap(s, rs, rt, rn, size);
-             return;
-         }
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_atomic(DisasContext *s, uint32_t insn,
-     int rs = extract32(insn, 16, 5);
-     int rn = extract32(insn, 5, 5);
-     int o3_opc = extract32(insn, 12, 4);
--    int feature = ARM_FEATURE_V8_ATOMICS;
-     TCGv_i64 tcg_rn, tcg_rs;
-     AtomicThreeOpFn *fn;
--    if (is_vector) {
-+    if (is_vector || !dc_isar_feature(aa64_atomics, s)) {
-         unallocated_encoding(s);
-         return;
-     }
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_atomic(DisasContext *s, uint32_t insn,
-         unallocated_encoding(s);
-         return;
-     }
--    if (!arm_dc_feature(s, feature)) {
--        unallocated_encoding(s);
--        return;
--    }
-     if (rn == 31) {
-         gen_check_sp_alignment(s);
-@@ -XXX,XX +XXX,XX @@ static void handle_crc32(DisasContext *s,
-     TCGv_i64 tcg_acc, tcg_val;
-     TCGv_i32 tcg_bytes;
--    if (!arm_dc_feature(s, ARM_FEATURE_CRC)
-+    if (!dc_isar_feature(aa64_crc32, s)
-         || (sf == 1 && sz != 3)
-         || (sf == 0 && sz == 3)) {
-         unallocated_encoding(s);
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_three_reg_same_extra(DisasContext *s,
-     bool u = extract32(insn, 29, 1);
-     TCGv_i32 ele1, ele2, ele3;
-     TCGv_i64 res;
--    int feature;
-+    bool feature;
-     switch (u * 16 + opcode) {
-     case 0x10: /* SQRDMLAH (vector) */
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_three_reg_same_extra(DisasContext *s,
-             unallocated_encoding(s);
-             return;
-         }
--        feature = ARM_FEATURE_V8_RDM;
-+        feature = dc_isar_feature(aa64_rdm, s);
-         break;
-     default:
-         unallocated_encoding(s);
-         return;
-     }
--    if (!arm_dc_feature(s, feature)) {
-+    if (!feature) {
-         unallocated_encoding(s);
-         return;
-     }
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_diff(DisasContext *s, uint32_t insn)
-             return;
-         }
-         if (size == 3) {
--            if (!arm_dc_feature(s, ARM_FEATURE_V8_PMULL)) {
-+            if (!dc_isar_feature(aa64_pmull, s)) {
-                 unallocated_encoding(s);
-                 return;
-             }
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
-     int size = extract32(insn, 22, 2);
-     bool u = extract32(insn, 29, 1);
-     bool is_q = extract32(insn, 30, 1);
--    int feature, rot;
-+    bool feature;
-+    int rot;
-     switch (u * 16 + opcode) {
-     case 0x10: /* SQRDMLAH (vector) */
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
-             unallocated_encoding(s);
-             return;
-         }
--        feature = ARM_FEATURE_V8_RDM;
-+        feature = dc_isar_feature(aa64_rdm, s);
-         break;
-     case 0x02: /* SDOT (vector) */
-     case 0x12: /* UDOT (vector) */
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
-             unallocated_encoding(s);
-             return;
-         }
--        feature = ARM_FEATURE_V8_DOTPROD;
-+        feature = dc_isar_feature(aa64_dp, s);
-         break;
-     case 0x18: /* FCMLA, #0 */
-     case 0x19: /* FCMLA, #90 */
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
-             unallocated_encoding(s);
-             return;
-         }
--        feature = ARM_FEATURE_V8_FCMA;
-+        feature = dc_isar_feature(aa64_fcma, s);
-         break;
-     default:
-         unallocated_encoding(s);
-         return;
-     }
--    if (!arm_dc_feature(s, feature)) {
-+    if (!feature) {
-         unallocated_encoding(s);
-         return;
-     }
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
-         break;
-     case 0x1d: /* SQRDMLAH */
-     case 0x1f: /* SQRDMLSH */
--        if (!arm_dc_feature(s, ARM_FEATURE_V8_RDM)) {
-+        if (!dc_isar_feature(aa64_rdm, s)) {
-             unallocated_encoding(s);
-             return;
-         }
-         break;
-     case 0x0e: /* SDOT */
-     case 0x1e: /* UDOT */
--        if (size != MO_32 || !arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
-+        if (size != MO_32 || !dc_isar_feature(aa64_dp, s)) {
-             unallocated_encoding(s);
-             return;
-         }
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
-     case 0x13: /* FCMLA #90 */
-     case 0x15: /* FCMLA #180 */
-     case 0x17: /* FCMLA #270 */
--        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)) {
-+        if (!dc_isar_feature(aa64_fcma, s)) {
-             unallocated_encoding(s);
-             return;
-         }
-@@ -XXX,XX +XXX,XX @@ static void disas_crypto_aes(DisasContext *s, uint32_t insn)
-     TCGv_i32 tcg_decrypt;
-     CryptoThreeOpIntFn *genfn;
--    if (!arm_dc_feature(s, ARM_FEATURE_V8_AES)
--        || size != 0) {
-+    if (!dc_isar_feature(aa64_aes, s) || size != 0) {
-         unallocated_encoding(s);
-         return;
-     }
-@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_sha(DisasContext *s, uint32_t insn)
-     int rd = extract32(insn, 0, 5);
-     CryptoThreeOpFn *genfn;
-     TCGv_ptr tcg_rd_ptr, tcg_rn_ptr, tcg_rm_ptr;
--    int feature = ARM_FEATURE_V8_SHA256;
-+    bool feature;
-     if (size != 0) {
-         unallocated_encoding(s);
-@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_sha(DisasContext *s, uint32_t insn)
-     case 2: /* SHA1M */
-     case 3: /* SHA1SU0 */
-         genfn = NULL;
--        feature = ARM_FEATURE_V8_SHA1;
-+        feature = dc_isar_feature(aa64_sha1, s);
-         break;
-     case 4: /* SHA256H */
-         genfn = gen_helper_crypto_sha256h;
-+        feature = dc_isar_feature(aa64_sha256, s);
-         break;
-     case 5: /* SHA256H2 */
-         genfn = gen_helper_crypto_sha256h2;
-+        feature = dc_isar_feature(aa64_sha256, s);
-         break;
-     case 6: /* SHA256SU1 */
-         genfn = gen_helper_crypto_sha256su1;
-+        feature = dc_isar_feature(aa64_sha256, s);
-         break;
-     default:
-         unallocated_encoding(s);
-         return;
-     }
--    if (!arm_dc_feature(s, feature)) {
-+    if (!feature) {
-         unallocated_encoding(s);
-         return;
-     }
-@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha(DisasContext *s, uint32_t insn)
-     int rn = extract32(insn, 5, 5);
-     int rd = extract32(insn, 0, 5);
-     CryptoTwoOpFn *genfn;
--    int feature;
-+    bool feature;
-     TCGv_ptr tcg_rd_ptr, tcg_rn_ptr;
-     if (size != 0) {
-@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha(DisasContext *s, uint32_t insn)
-     switch (opcode) {
-     case 0: /* SHA1H */
--        feature = ARM_FEATURE_V8_SHA1;
-+        feature = dc_isar_feature(aa64_sha1, s);
-         genfn = gen_helper_crypto_sha1h;
-         break;
-     case 1: /* SHA1SU1 */
--        feature = ARM_FEATURE_V8_SHA1;
-+        feature = dc_isar_feature(aa64_sha1, s);
-         genfn = gen_helper_crypto_sha1su1;
-         break;
-     case 2: /* SHA256SU0 */
--        feature = ARM_FEATURE_V8_SHA256;
-+        feature = dc_isar_feature(aa64_sha256, s);
-         genfn = gen_helper_crypto_sha256su0;
-         break;
-     default:
-@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha(DisasContext *s, uint32_t insn)
-         return;
-     }
--    if (!arm_dc_feature(s, feature)) {
-+    if (!feature) {
-         unallocated_encoding(s);
-         return;
-     }
-@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_sha512(DisasContext *s, uint32_t insn)
-     int rm = extract32(insn, 16, 5);
-     int rn = extract32(insn, 5, 5);
-     int rd = extract32(insn, 0, 5);
--    int feature;
-+    bool feature;
-     CryptoThreeOpFn *genfn;
-     if (o == 0) {
-         switch (opcode) {
-         case 0: /* SHA512H */
--            feature = ARM_FEATURE_V8_SHA512;
-+            feature = dc_isar_feature(aa64_sha512, s);
-             genfn = gen_helper_crypto_sha512h;
-             break;
-         case 1: /* SHA512H2 */
--            feature = ARM_FEATURE_V8_SHA512;
-+            feature = dc_isar_feature(aa64_sha512, s);
-             genfn = gen_helper_crypto_sha512h2;
-             break;
-         case 2: /* SHA512SU1 */
--            feature = ARM_FEATURE_V8_SHA512;
-+            feature = dc_isar_feature(aa64_sha512, s);
-             genfn = gen_helper_crypto_sha512su1;
-             break;
-         case 3: /* RAX1 */
--            feature = ARM_FEATURE_V8_SHA3;
-+            feature = dc_isar_feature(aa64_sha3, s);
-             genfn = NULL;
-             break;
-         }
-     } else {
-         switch (opcode) {
-         case 0: /* SM3PARTW1 */
--            feature = ARM_FEATURE_V8_SM3;
-+            feature = dc_isar_feature(aa64_sm3, s);
-             genfn = gen_helper_crypto_sm3partw1;
-             break;
-         case 1: /* SM3PARTW2 */
--            feature = ARM_FEATURE_V8_SM3;
-+            feature = dc_isar_feature(aa64_sm3, s);
-             genfn = gen_helper_crypto_sm3partw2;
-             break;
-         case 2: /* SM4EKEY */
--            feature = ARM_FEATURE_V8_SM4;
-+            feature = dc_isar_feature(aa64_sm4, s);
-             genfn = gen_helper_crypto_sm4ekey;
-             break;
-         default:
-@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_sha512(DisasContext *s, uint32_t insn)
-         }
-     }
--    if (!arm_dc_feature(s, feature)) {
-+    if (!feature) {
-         unallocated_encoding(s);
-         return;
-     }
-@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha512(DisasContext *s, uint32_t insn)
-     int rn = extract32(insn, 5, 5);
-     int rd = extract32(insn, 0, 5);
-     TCGv_ptr tcg_rd_ptr, tcg_rn_ptr;
--    int feature;
-+    bool feature;
-     CryptoTwoOpFn *genfn;
-     switch (opcode) {
-     case 0: /* SHA512SU0 */
--        feature = ARM_FEATURE_V8_SHA512;
-+        feature = dc_isar_feature(aa64_sha512, s);
-         genfn = gen_helper_crypto_sha512su0;
-         break;
-     case 1: /* SM4E */
--        feature = ARM_FEATURE_V8_SM4;
-+        feature = dc_isar_feature(aa64_sm4, s);
-         genfn = gen_helper_crypto_sm4e;
-         break;
-     default:
-@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha512(DisasContext *s, uint32_t insn)
-         return;
-     }
--    if (!arm_dc_feature(s, feature)) {
-+    if (!feature) {
-         unallocated_encoding(s);
-         return;
-     }
-@@ -XXX,XX +XXX,XX @@ static void disas_crypto_four_reg(DisasContext *s, uint32_t insn)
-     int ra = extract32(insn, 10, 5);
-     int rn = extract32(insn, 5, 5);
-     int rd = extract32(insn, 0, 5);
--    int feature;
-+    bool feature;
-     switch (op0) {
-     case 0: /* EOR3 */
-     case 1: /* BCAX */
--        feature = ARM_FEATURE_V8_SHA3;
-+        feature = dc_isar_feature(aa64_sha3, s);
-         break;
-     case 2: /* SM3SS1 */
--        feature = ARM_FEATURE_V8_SM3;
-+        feature = dc_isar_feature(aa64_sm3, s);
-         break;
-     default:
-         unallocated_encoding(s);
-         return;
-     }
--    if (!arm_dc_feature(s, feature)) {
-+    if (!feature) {
-         unallocated_encoding(s);
-         return;
-     }
-@@ -XXX,XX +XXX,XX @@ static void disas_crypto_xar(DisasContext *s, uint32_t insn)
-     TCGv_i64 tcg_op1, tcg_op2, tcg_res[2];
-     int pass;
--    if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA3)) {
-+    if (!dc_isar_feature(aa64_sha3, s)) {
-         unallocated_encoding(s);
-         return;
-     }
-@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_imm2(DisasContext *s, uint32_t insn)
-     TCGv_ptr tcg_rd_ptr, tcg_rn_ptr, tcg_rm_ptr;
-     TCGv_i32 tcg_imm2, tcg_opcode;
--    if (!arm_dc_feature(s, ARM_FEATURE_V8_SM3)) {
-+    if (!dc_isar_feature(aa64_sm3, s)) {
-         unallocated_encoding(s);
-         return;
-     }
-@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_init_disas_context(DisasContextBase *dcbase,
-     ARMCPU *arm_cpu = arm_env_get_cpu(env);
-     int bound;
-+    dc->isar = &arm_cpu->isar;
-     dc->pc = dc->base.pc_first;
-     dc->condjmp = 0;
-diff --git a/target/arm/translate.c b/target/arm/translate.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
-+++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static const uint8_t neon_2rm_sizes[] = {
- static int do_v81_helper(DisasContext *s, gen_helper_gvec_3_ptr *fn,
-                          int q, int rd, int rn, int rm)
- {
--    if (arm_dc_feature(s, ARM_FEATURE_V8_RDM)) {
-+    if (dc_isar_feature(aa32_rdm, s)) {
-         int opr_sz = (1 + q) * 8;
-         tcg_gen_gvec_3_ptr(vfp_reg_offset(1, rd),
-                            vfp_reg_offset(1, rn),
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                 return 1;
-             }
-             if (!u) { /* SHA-1 */
--                if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA1)) {
-+                if (!dc_isar_feature(aa32_sha1, s)) {
-                     return 1;
-                 }
-                 ptr1 = vfp_reg_ptr(true, rd);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                 gen_helper_crypto_sha1_3reg(ptr1, ptr2, ptr3, tmp4);
-                 tcg_temp_free_i32(tmp4);
-             } else { /* SHA-256 */
--                if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA256) || size == 3) {
-+                if (!dc_isar_feature(aa32_sha2, s) || size == 3) {
-                     return 1;
-                 }
-                 ptr1 = vfp_reg_ptr(true, rd);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                 if (op == 14 && size == 2) {
-                     TCGv_i64 tcg_rn, tcg_rm, tcg_rd;
--                    if (!arm_dc_feature(s, ARM_FEATURE_V8_PMULL)) {
-+                    if (!dc_isar_feature(aa32_pmull, s)) {
-                         return 1;
-                     }
-                     tcg_rn = tcg_temp_new_i64();
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                     {
-                         NeonGenThreeOpEnvFn *fn;
--                        if (!arm_dc_feature(s, ARM_FEATURE_V8_RDM)) {
-+                        if (!dc_isar_feature(aa32_rdm, s)) {
-                             return 1;
-                         }
-                         if (u && ((rd | rn) & 1)) {
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                     break;
-                 }
-                 case NEON_2RM_AESE: case NEON_2RM_AESMC:
--                    if (!arm_dc_feature(s, ARM_FEATURE_V8_AES)
--                        || ((rm | rd) & 1)) {
-+                    if (!dc_isar_feature(aa32_aes, s) || ((rm | rd) & 1)) {
-                         return 1;
-                     }
-                     ptr1 = vfp_reg_ptr(true, rd);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                     tcg_temp_free_i32(tmp3);
-                     break;
-                 case NEON_2RM_SHA1H:
--                    if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA1)
--                        || ((rm | rd) & 1)) {
-+                    if (!dc_isar_feature(aa32_sha1, s) || ((rm | rd) & 1)) {
-                         return 1;
-                     }
-                     ptr1 = vfp_reg_ptr(true, rd);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                     }
-                     /* bit 6 (q): set -> SHA256SU0, cleared -> SHA1SU1 */
-                     if (q) {
--                        if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA256)) {
-+                        if (!dc_isar_feature(aa32_sha2, s)) {
-                             return 1;
-                         }
--                    } else if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA1)) {
-+                    } else if (!dc_isar_feature(aa32_sha1, s)) {
-                         return 1;
-                     }
-                     ptr1 = vfp_reg_ptr(true, rd);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
-         /* VCMLA -- 1111 110R R.1S .... .... 1000 ...0 .... */
-         int size = extract32(insn, 20, 1);
-         data = extract32(insn, 23, 2); /* rot */
--        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)
-+        if (!dc_isar_feature(aa32_vcma, s)
-             || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
-             return 1;
-         }
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
-         /* VCADD -- 1111 110R 1.0S .... .... 1000 ...0 .... */
-         int size = extract32(insn, 20, 1);
-         data = extract32(insn, 24, 1); /* rot */
--        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)
-+        if (!dc_isar_feature(aa32_vcma, s)
-             || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
-             return 1;
-         }
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
-     } else if ((insn & 0xfeb00f00) == 0xfc200d00) {
-         /* V[US]DOT -- 1111 1100 0.10 .... .... 1101 .Q.U .... */
-         bool u = extract32(insn, 4, 1);
--        if (!arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
-+        if (!dc_isar_feature(aa32_dp, s)) {
-             return 1;
-         }
-         fn_gvec = u ? gen_helper_gvec_udot_b : gen_helper_gvec_sdot_b;
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
-         int size = extract32(insn, 23, 1);
-         int index;
--        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)) {
-+        if (!dc_isar_feature(aa32_vcma, s)) {
-             return 1;
-         }
-         if (size == 0) {
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
-     } else if ((insn & 0xffb00f00) == 0xfe200d00) {
-         /* V[US]DOT -- 1111 1110 0.10 .... .... 1101 .Q.U .... */
-         int u = extract32(insn, 4, 1);
--        if (!arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
-+        if (!dc_isar_feature(aa32_dp, s)) {
-             return 1;
-         }
-         fn_gvec = u ? gen_helper_gvec_udot_idx_b : gen_helper_gvec_sdot_idx_b;
-@@ -XXX,XX +XXX,XX @@ static void disas_arm_insn(DisasContext *s, unsigned int insn)
-              * op1 == 3 is UNPREDICTABLE but handle as UNDEFINED.
-              * Bits 8, 10 and 11 should be zero.
-              */
--            if (!arm_dc_feature(s, ARM_FEATURE_CRC) || op1 == 0x3 ||
--                (c & 0xd) != 0) {
-+            if (!dc_isar_feature(aa32_crc32, s) || op1 == 0x3 || (c & 0xd) != 0) {
-                 goto illegal_op;
-             }
-@@ -XXX,XX +XXX,XX @@ static void disas_thumb2_insn(DisasContext *s, uint32_t insn)
-                 case 0x28:
-                 case 0x29:
-                 case 0x2a:
--                    if (!arm_dc_feature(s, ARM_FEATURE_CRC)) {
-+                    if (!dc_isar_feature(aa32_crc32, s)) {
-                         goto illegal_op;
-                     }
-                     break;
-@@ -XXX,XX +XXX,XX @@ static void arm_tr_init_disas_context(DisasContextBase *dcbase, CPUState *cs)
-     CPUARMState *env = cs->env_ptr;
-     ARMCPU *cpu = arm_env_get_cpu(env);
-+    dc->isar = &cpu->isar;
-     dc->pc = dc->base.pc_first;
-     dc->condjmp = 0;
 --
-.19.1
+.25.1

-New patch
+[PULL 005/117] target/arm: Move null function and sve check into gen_gvec_ool_zz
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-3-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 36 +++++++++++++++---------------------
+file changed, 15 insertions(+), 21 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static int pred_gvec_reg_size(DisasContext *s)
+ }
+ /* Invoke an out-of-line helper on 2 Zregs. */
+-static void gen_gvec_ool_zz(DisasContext *s, gen_helper_gvec_2 *fn,
++static bool gen_gvec_ool_zz(DisasContext *s, gen_helper_gvec_2 *fn,
+                             int rd, int rn, int data)
+ {
+-    unsigned vsz = vec_full_reg_size(s);
+-    tcg_gen_gvec_2_ool(vec_full_reg_offset(s, rd),
+-                       vec_full_reg_offset(s, rn),
+-                       vsz, vsz, data, fn);
++    if (fn == NULL) {
++        return false;
++    }
++    if (sve_access_check(s)) {
++        unsigned vsz = vec_full_reg_size(s);
++        tcg_gen_gvec_2_ool(vec_full_reg_offset(s, rd),
++                           vec_full_reg_offset(s, rn),
++                           vsz, vsz, data, fn);
++    }
++    return true;
+ }
+ /* Invoke an out-of-line helper on 3 Zregs. */
+@@ -XXX,XX +XXX,XX @@ static bool trans_FEXPA(DisasContext *s, arg_rr_esz *a)
+         gen_helper_sve_fexpa_s,
+         gen_helper_sve_fexpa_d,
+     };
+-    if (a->esz == 0) {
+-        return false;
+-    }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zz(s, fns[a->esz], a->rd, a->rn, 0);
+-    }
+-    return true;
++    return gen_gvec_ool_zz(s, fns[a->esz], a->rd, a->rn, 0);
+ }
+ static bool trans_FTSSEL(DisasContext *s, arg_rrr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_REV_v(DisasContext *s, arg_rr_esz *a)
+         gen_helper_sve_rev_b, gen_helper_sve_rev_h,
+         gen_helper_sve_rev_s, gen_helper_sve_rev_d
+     };
+-
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zz(s, fns[a->esz], a->rd, a->rn, 0);
+-    }
+-    return true;
++    return gen_gvec_ool_zz(s, fns[a->esz], a->rd, a->rn, 0);
+ }
+ static bool trans_TBL(DisasContext *s, arg_rrr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_AESMC(DisasContext *s, arg_AESMC *a)
+     if (!dc_isar_feature(aa64_sve2_aes, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zz(s, gen_helper_crypto_aesmc, a->rd, a->rd, a->decrypt);
+-    }
+-    return true;
++    return gen_gvec_ool_zz(s, gen_helper_crypto_aesmc,
++                           a->rd, a->rd, a->decrypt);
+ }
+ static bool do_aese(DisasContext *s, arg_rrr_esz *a, bool decrypt)
+--
+.25.1

-New patch
+[PULL 006/117] target/arm: Use TRANS_FEAT for gen_gvec_ool_zz
+From: Richard Henderson <richard.henderson@linaro.org>
+Convert SVE translation functions using gen_gvec_ool_zz to TRANS_FEAT.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-4-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 39 +++++++++++++-------------------------
+file changed, 13 insertions(+), 26 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool trans_ADR_u32(DisasContext *s, arg_rrri *a)
+  *** SVE Integer Misc - Unpredicated Group
+  */
+-static bool trans_FEXPA(DisasContext *s, arg_rr_esz *a)
+-{
+-    static gen_helper_gvec_2 * const fns[4] = {
+-        NULL,
+-        gen_helper_sve_fexpa_h,
+-        gen_helper_sve_fexpa_s,
+-        gen_helper_sve_fexpa_d,
+-    };
+-    return gen_gvec_ool_zz(s, fns[a->esz], a->rd, a->rn, 0);
+-}
++static gen_helper_gvec_2 * const fexpa_fns[4] = {
++    NULL,                   gen_helper_sve_fexpa_h,
++    gen_helper_sve_fexpa_s, gen_helper_sve_fexpa_d,
++};
++TRANS_FEAT(FEXPA, aa64_sve, gen_gvec_ool_zz,
++           fexpa_fns[a->esz], a->rd, a->rn, 0)
+ static bool trans_FTSSEL(DisasContext *s, arg_rrr_esz *a)
+ {
+@@ -XXX,XX +XXX,XX @@ static bool trans_INSR_r(DisasContext *s, arg_rrr_esz *a)
+     return true;
+ }
+-static bool trans_REV_v(DisasContext *s, arg_rr_esz *a)
+-{
+-    static gen_helper_gvec_2 * const fns[4] = {
+-        gen_helper_sve_rev_b, gen_helper_sve_rev_h,
+-        gen_helper_sve_rev_s, gen_helper_sve_rev_d
+-    };
+-    return gen_gvec_ool_zz(s, fns[a->esz], a->rd, a->rn, 0);
+-}
++static gen_helper_gvec_2 * const rev_fns[4] = {
++    gen_helper_sve_rev_b, gen_helper_sve_rev_h,
++    gen_helper_sve_rev_s, gen_helper_sve_rev_d
++};
++TRANS_FEAT(REV_v, aa64_sve, gen_gvec_ool_zz, rev_fns[a->esz], a->rd, a->rn, 0)
+ static bool trans_TBL(DisasContext *s, arg_rrr_esz *a)
+ {
+@@ -XXX,XX +XXX,XX @@ static bool trans_USDOT_zzzz(DisasContext *s, arg_USDOT_zzzz *a)
+     return true;
+ }
+-static bool trans_AESMC(DisasContext *s, arg_AESMC *a)
+-{
+-    if (!dc_isar_feature(aa64_sve2_aes, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_zz(s, gen_helper_crypto_aesmc,
+-                           a->rd, a->rd, a->decrypt);
+-}
++TRANS_FEAT(AESMC, aa64_sve2_aes, gen_gvec_ool_zz,
++           gen_helper_crypto_aesmc, a->rd, a->rd, a->decrypt)
+ static bool do_aese(DisasContext *s, arg_rrr_esz *a, bool decrypt)
+ {
+--
+.25.1

-New patch
+[PULL 007/117] target/arm: Move null function and sve check into gen_gvec_ool_zzz
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-5-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 74 ++++++++++++--------------------------
+file changed, 23 insertions(+), 51 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_zz(DisasContext *s, gen_helper_gvec_2 *fn,
+ }
+ /* Invoke an out-of-line helper on 3 Zregs. */
+-static void gen_gvec_ool_zzz(DisasContext *s, gen_helper_gvec_3 *fn,
++static bool gen_gvec_ool_zzz(DisasContext *s, gen_helper_gvec_3 *fn,
+                              int rd, int rn, int rm, int data)
+ {
+-    unsigned vsz = vec_full_reg_size(s);
+-    tcg_gen_gvec_3_ool(vec_full_reg_offset(s, rd),
+-                       vec_full_reg_offset(s, rn),
+-                       vec_full_reg_offset(s, rm),
+-                       vsz, vsz, data, fn);
++    if (fn == NULL) {
++        return false;
++    }
++    if (sve_access_check(s)) {
++        unsigned vsz = vec_full_reg_size(s);
++        tcg_gen_gvec_3_ool(vec_full_reg_offset(s, rd),
++                           vec_full_reg_offset(s, rn),
++                           vec_full_reg_offset(s, rm),
++                           vsz, vsz, data, fn);
++    }
++    return true;
+ }
+ /* Invoke an out-of-line helper on 4 Zregs. */
+@@ -XXX,XX +XXX,XX @@ static bool trans_LSL_zzi(DisasContext *s, arg_rri_esz *a)
+ static bool do_zzw_ool(DisasContext *s, arg_rrr_esz *a, gen_helper_gvec_3 *fn)
+ {
+-    if (fn == NULL) {
+-        return false;
+-    }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzz(s, fn, a->rd, a->rn, a->rm, 0);
+-    }
+-    return true;
++    return gen_gvec_ool_zzz(s, fn, a->rd, a->rn, a->rm, 0);
+ }
+ #define DO_ZZW(NAME, name) \
+@@ -XXX,XX +XXX,XX @@ static bool trans_RDVL(DisasContext *s, arg_RDVL *a)
+ static bool do_adr(DisasContext *s, arg_rrri *a, gen_helper_gvec_3 *fn)
+ {
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzz(s, fn, a->rd, a->rn, a->rm, a->imm);
+-    }
+-    return true;
++    return gen_gvec_ool_zzz(s, fn, a->rd, a->rn, a->rm, a->imm);
+ }
+ static bool trans_ADR_p32(DisasContext *s, arg_rrri *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_FTSSEL(DisasContext *s, arg_rrr_esz *a)
+         gen_helper_sve_ftssel_s,
+         gen_helper_sve_ftssel_d,
+     };
+-    if (a->esz == 0) {
+-        return false;
+-    }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzz(s, fns[a->esz], a->rd, a->rn, a->rm, 0);
+-    }
+-    return true;
++    return gen_gvec_ool_zzz(s, fns[a->esz], a->rd, a->rn, a->rm, 0);
+ }
+ /*
+@@ -XXX,XX +XXX,XX @@ static bool trans_TBL(DisasContext *s, arg_rrr_esz *a)
+         gen_helper_sve_tbl_b, gen_helper_sve_tbl_h,
+         gen_helper_sve_tbl_s, gen_helper_sve_tbl_d
+     };
+-
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzz(s, fns[a->esz], a->rd, a->rn, a->rm, 0);
+-    }
+-    return true;
++    return gen_gvec_ool_zzz(s, fns[a->esz], a->rd, a->rn, a->rm, 0);
+ }
+ static bool trans_TBL_sve2(DisasContext *s, arg_rrr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_TBX(DisasContext *s, arg_rrr_esz *a)
+     if (!dc_isar_feature(aa64_sve2, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzz(s, fns[a->esz], a->rd, a->rn, a->rm, 0);
+-    }
+-    return true;
++    return gen_gvec_ool_zzz(s, fns[a->esz], a->rd, a->rn, a->rm, 0);
+ }
+ static bool trans_UNPK(DisasContext *s, arg_UNPK *a)
+@@ -XXX,XX +XXX,XX @@ static bool do_zip(DisasContext *s, arg_rrr_esz *a, bool high)
+ static bool do_zzz_data_ool(DisasContext *s, arg_rrr_esz *a, int data,
+                             gen_helper_gvec_3 *fn)
+ {
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzz(s, fn, a->rd, a->rn, a->rm, data);
+-    }
+-    return true;
++    return gen_gvec_ool_zzz(s, fn, a->rd, a->rn, a->rm, data);
+ }
+ static bool trans_ZIP1_z(DisasContext *s, arg_rrr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_MUL_zzz(DisasContext *s, arg_rrr_esz *a)
+ static bool do_sve2_zzz_ool(DisasContext *s, arg_rrr_esz *a,
+                             gen_helper_gvec_3 *fn)
+ {
+-    if (fn == NULL || !dc_isar_feature(aa64_sve2, s)) {
++    if (!dc_isar_feature(aa64_sve2, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzz(s, fn, a->rd, a->rn, a->rm, 0);
+-    }
+-    return true;
++    return gen_gvec_ool_zzz(s, fn, a->rd, a->rn, a->rm, 0);
+ }
+ static bool trans_SMULH_zzz(DisasContext *s, arg_rrr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool do_aese(DisasContext *s, arg_rrr_esz *a, bool decrypt)
+     if (!dc_isar_feature(aa64_sve2_aes, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzz(s, gen_helper_crypto_aese,
+-                         a->rd, a->rn, a->rm, decrypt);
+-    }
+-    return true;
++    return gen_gvec_ool_zzz(s, gen_helper_crypto_aese,
++                            a->rd, a->rn, a->rm, decrypt);
+ }
+ static bool trans_AESE(DisasContext *s, arg_rrr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool do_sm4(DisasContext *s, arg_rrr_esz *a, gen_helper_gvec_3 *fn)
+     if (!dc_isar_feature(aa64_sve2_sm4, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzz(s, fn, a->rd, a->rn, a->rm, 0);
+-    }
+-    return true;
++    return gen_gvec_ool_zzz(s, fn, a->rd, a->rn, a->rm, 0);
+ }
+ static bool trans_SM4E(DisasContext *s, arg_rrr_esz *a)
+--
+.25.1

-[Qemu-devel] [PULL 29/45] target/arm: Use gvec for NEON_3R_LOGIC insns
+[PULL 008/117] target/arm: Introduce gen_gvec_ool_arg_zzz
 From: Richard Henderson <richard.henderson@linaro.org>
-Move expanders for VBSL, VBIT, and VBIF from translate-a64.c.
+Use gen_gvec_ool_arg_zzz instead of gen_gvec_ool_zzz
 when the arguments come from arg_rrr_esz.
 Replaces do_zzw_ool and do_zzz_data_ool.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-9-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-6-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.h     |   6 ++
+ target/arm/translate-sve.c | 48 +++++++++++++++++---------------------
- target/arm/translate-a64.c |  61 --------------
+file changed, 21 insertions(+), 27 deletions(-)
  target/arm/translate.c     | 162 +++++++++++++++++++++++++++----------
 files changed, 124 insertions(+), 105 deletions(-)
-diff --git a/target/arm/translate.h b/target/arm/translate.h
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static inline TCGv_i32 get_ahp_flag(void)
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_zzz(DisasContext *s, gen_helper_gvec_3 *fn,
-     return ret;
+     return true;
  }
++static bool gen_gvec_ool_arg_zzz(DisasContext *s, gen_helper_gvec_3 *fn,
++                                 arg_rrr_esz *a, int data)
++{
++    return gen_gvec_ool_zzz(s, fn, a->rd, a->rn, a->rm, data);
++}
 +
-+/* Vector operations shared between ARM and AArch64.  */
+ /* Invoke an out-of-line helper on 4 Zregs. */
-+extern const GVecGen3 bsl_op;
+ static void gen_gvec_ool_zzzz(DisasContext *s, gen_helper_gvec_4 *fn,
-+extern const GVecGen3 bit_op;
+                               int rd, int rn, int rm, int ra, int data)
-+extern const GVecGen3 bif_op;
+@@ -XXX,XX +XXX,XX @@ static bool trans_LSL_zzi(DisasContext *s, arg_rri_esz *a)
-+
+     return do_shift_imm(s, a, false, tcg_gen_gvec_shli);
  /*
   * Forward to the isar_feature_* tests given a DisasContext pointer.
   */
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_diff(DisasContext *s, uint32_t insn)
      }
  }
--static void gen_bsl_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
+-static bool do_zzw_ool(DisasContext *s, arg_rrr_esz *a, gen_helper_gvec_3 *fn)
 -{
--    tcg_gen_xor_i64(rn, rn, rm);
+-    return gen_gvec_ool_zzz(s, fn, a->rd, a->rn, a->rm, 0);
 -    tcg_gen_and_i64(rn, rn, rd);
 -    tcg_gen_xor_i64(rd, rm, rn);
 -}
 -
--static void gen_bit_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
+ #define DO_ZZW(NAME, name) \
  static bool trans_##NAME##_zzw(DisasContext *s, arg_rrr_esz *a)           \
  {                                                                         \
@@ -XXX,XX +XXX,XX @@ static bool trans_##NAME##_zzw(DisasContext *s, arg_rrr_esz *a)           \
          gen_helper_sve_##name##_zzw_b, gen_helper_sve_##name##_zzw_h,     \
          gen_helper_sve_##name##_zzw_s, NULL                               \
      };                                                                    \
 -    return do_zzw_ool(s, a, fns[a->esz]);                                 \
 +    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, 0);                    \
  }
  DO_ZZW(ASR, asr)
@@ -XXX,XX +XXX,XX @@ static bool trans_FTSSEL(DisasContext *s, arg_rrr_esz *a)
          gen_helper_sve_ftssel_s,
          gen_helper_sve_ftssel_d,
      };
 -    return gen_gvec_ool_zzz(s, fns[a->esz], a->rd, a->rn, a->rm, 0);
 +    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, 0);
  }
  /*
@@ -XXX,XX +XXX,XX @@ static bool trans_TBL(DisasContext *s, arg_rrr_esz *a)
          gen_helper_sve_tbl_b, gen_helper_sve_tbl_h,
          gen_helper_sve_tbl_s, gen_helper_sve_tbl_d
      };
 -    return gen_gvec_ool_zzz(s, fns[a->esz], a->rd, a->rn, a->rm, 0);
 +    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, 0);
  }
  static bool trans_TBL_sve2(DisasContext *s, arg_rrr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_TBX(DisasContext *s, arg_rrr_esz *a)
      if (!dc_isar_feature(aa64_sve2, s)) {
          return false;
      }
 -    return gen_gvec_ool_zzz(s, fns[a->esz], a->rd, a->rn, a->rm, 0);
 +    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, 0);
  }
  static bool trans_UNPK(DisasContext *s, arg_UNPK *a)
@@ -XXX,XX +XXX,XX @@ static bool do_zip(DisasContext *s, arg_rrr_esz *a, bool high)
      return true;
  }
 -static bool do_zzz_data_ool(DisasContext *s, arg_rrr_esz *a, int data,
 -                            gen_helper_gvec_3 *fn)
 -{
--    tcg_gen_xor_i64(rn, rn, rd);
+-    return gen_gvec_ool_zzz(s, fn, a->rd, a->rn, a->rm, data);
 -    tcg_gen_and_i64(rn, rn, rm);
 -    tcg_gen_xor_i64(rd, rd, rn);
 -}
 -
--static void gen_bif_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
+ static bool trans_ZIP1_z(DisasContext *s, arg_rrr_esz *a)
 -{
 -    tcg_gen_xor_i64(rn, rn, rd);
 -    tcg_gen_andc_i64(rn, rn, rm);
 -    tcg_gen_xor_i64(rd, rd, rn);
 -}
 -
 -static void gen_bsl_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
 -{
 -    tcg_gen_xor_vec(vece, rn, rn, rm);
 -    tcg_gen_and_vec(vece, rn, rn, rd);
 -    tcg_gen_xor_vec(vece, rd, rm, rn);
 -}
 -
 -static void gen_bit_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
 -{
 -    tcg_gen_xor_vec(vece, rn, rn, rd);
 -    tcg_gen_and_vec(vece, rn, rn, rm);
 -    tcg_gen_xor_vec(vece, rd, rd, rn);
 -}
 -
 -static void gen_bif_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
 -{
 -    tcg_gen_xor_vec(vece, rn, rn, rd);
 -    tcg_gen_andc_vec(vece, rn, rn, rm);
 -    tcg_gen_xor_vec(vece, rd, rd, rn);
 -}
 -
  /* Logic op (opcode == 3) subgroup of C3.6.16. */
  static void disas_simd_3same_logic(DisasContext *s, uint32_t insn)
  {
--    static const GVecGen3 bsl_op = {
+     return do_zip(s, a, false);
--        .fni8 = gen_bsl_i64,
+@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_3 * const uzp_fns[4] = {
--        .fniv = gen_bsl_vec,
--        .prefer_i64 = TCG_TARGET_REG_BITS == 64,
+ static bool trans_UZP1_z(DisasContext *s, arg_rrr_esz *a)
--        .load_dest = true
+ {
--    };
+-    return do_zzz_data_ool(s, a, 0, uzp_fns[a->esz]);
--    static const GVecGen3 bit_op = {
++    return gen_gvec_ool_arg_zzz(s, uzp_fns[a->esz], a, 0);
 -        .fni8 = gen_bit_i64,
 -        .fniv = gen_bit_vec,
 -        .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -        .load_dest = true
 -    };
 -    static const GVecGen3 bif_op = {
 -        .fni8 = gen_bif_i64,
 -        .fniv = gen_bif_vec,
 -        .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -        .load_dest = true
 -    };
 -
      int rd = extract32(insn, 0, 5);
      int rn = extract32(insn, 5, 5);
      int rm = extract32(insn, 16, 5);
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
      return 0;
  }
--/* Bitwise select.  dest = c ? t : f.  Clobbers T and F.  */
+ static bool trans_UZP2_z(DisasContext *s, arg_rrr_esz *a)
 -static void gen_neon_bsl(TCGv_i32 dest, TCGv_i32 t, TCGv_i32 f, TCGv_i32 c)
 -{
 -    tcg_gen_and_i32(t, t, c);
 -    tcg_gen_andc_i32(f, f, c);
 -    tcg_gen_or_i32(dest, t, f);
 -}
 -
  static inline void gen_neon_narrow(int size, TCGv_i32 dest, TCGv_i64 src)
  {
-     switch (size) {
+-    return do_zzz_data_ool(s, a, 1 << a->esz, uzp_fns[a->esz]);
-@@ -XXX,XX +XXX,XX @@ static int do_v81_helper(DisasContext *s, gen_helper_gvec_3_ptr *fn,
++    return gen_gvec_ool_arg_zzz(s, uzp_fns[a->esz], a, 1 << a->esz);
      return 1;
  }
-+/*
+ static bool trans_UZP1_q(DisasContext *s, arg_rrr_esz *a)
-+ * Expanders for VBitOps_VBIF, VBIT, VBSL.
+@@ -XXX,XX +XXX,XX @@ static bool trans_UZP1_q(DisasContext *s, arg_rrr_esz *a)
-+ */
+     if (!dc_isar_feature(aa64_sve_f64mm, s)) {
-+static void gen_bsl_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
+         return false;
-+{
+     }
-+    tcg_gen_xor_i64(rn, rn, rm);
+-    return do_zzz_data_ool(s, a, 0, gen_helper_sve2_uzp_q);
-+    tcg_gen_and_i64(rn, rn, rd);
++    return gen_gvec_ool_arg_zzz(s, gen_helper_sve2_uzp_q, a, 0);
-+    tcg_gen_xor_i64(rd, rm, rn);
+ }
-+}
-+
+ static bool trans_UZP2_q(DisasContext *s, arg_rrr_esz *a)
-+static void gen_bit_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
+@@ -XXX,XX +XXX,XX @@ static bool trans_UZP2_q(DisasContext *s, arg_rrr_esz *a)
-+{
+     if (!dc_isar_feature(aa64_sve_f64mm, s)) {
-+    tcg_gen_xor_i64(rn, rn, rd);
+         return false;
-+    tcg_gen_and_i64(rn, rn, rm);
+     }
-+    tcg_gen_xor_i64(rd, rd, rn);
+-    return do_zzz_data_ool(s, a, 16, gen_helper_sve2_uzp_q);
-+}
++    return gen_gvec_ool_arg_zzz(s, gen_helper_sve2_uzp_q, a, 16);
-+
+ }
-+static void gen_bif_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
-+{
+ static gen_helper_gvec_3 * const trn_fns[4] = {
-+    tcg_gen_xor_i64(rn, rn, rd);
+@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_3 * const trn_fns[4] = {
-+    tcg_gen_andc_i64(rn, rn, rm);
-+    tcg_gen_xor_i64(rd, rd, rn);
+ static bool trans_TRN1_z(DisasContext *s, arg_rrr_esz *a)
 +}
 +
 +static void gen_bsl_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
 +{
 +    tcg_gen_xor_vec(vece, rn, rn, rm);
 +    tcg_gen_and_vec(vece, rn, rn, rd);
 +    tcg_gen_xor_vec(vece, rd, rm, rn);
 +}
 +
 +static void gen_bit_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
 +{
 +    tcg_gen_xor_vec(vece, rn, rn, rd);
 +    tcg_gen_and_vec(vece, rn, rn, rm);
 +    tcg_gen_xor_vec(vece, rd, rd, rn);
 +}
 +
 +static void gen_bif_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
 +{
 +    tcg_gen_xor_vec(vece, rn, rn, rd);
 +    tcg_gen_andc_vec(vece, rn, rn, rm);
 +    tcg_gen_xor_vec(vece, rd, rd, rn);
 +}
 +
 +const GVecGen3 bsl_op = {
 +    .fni8 = gen_bsl_i64,
 +    .fniv = gen_bsl_vec,
 +    .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 +    .load_dest = true
 +};
 +
 +const GVecGen3 bit_op = {
 +    .fni8 = gen_bit_i64,
 +    .fniv = gen_bit_vec,
 +    .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 +    .load_dest = true
 +};
 +
 +const GVecGen3 bif_op = {
 +    .fni8 = gen_bif_i64,
 +    .fniv = gen_bif_vec,
 +    .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 +    .load_dest = true
 +};
 +
 +
  /* Translate a NEON data processing instruction.  Return nonzero if the
     instruction is invalid.
     We process data in a mixture of 32-bit and 64-bit chunks.
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
  {
-     int op;
+-    return do_zzz_data_ool(s, a, 0, trn_fns[a->esz]);
-     int q;
++    return gen_gvec_ool_arg_zzz(s, trn_fns[a->esz], a, 0);
--    int rd, rn, rm;
+ }
-+    int rd, rn, rm, rd_ofs, rn_ofs, rm_ofs;
-     int size;
+ static bool trans_TRN2_z(DisasContext *s, arg_rrr_esz *a)
-     int shift;
+ {
-     int pass;
+-    return do_zzz_data_ool(s, a, 1 << a->esz, trn_fns[a->esz]);
-     int count;
++    return gen_gvec_ool_arg_zzz(s, trn_fns[a->esz], a, 1 << a->esz);
-     int pairwise;
+ }
-     int u;
-+    int vec_size;
+ static bool trans_TRN1_q(DisasContext *s, arg_rrr_esz *a)
-     uint32_t imm, mask;
+@@ -XXX,XX +XXX,XX @@ static bool trans_TRN1_q(DisasContext *s, arg_rrr_esz *a)
-     TCGv_i32 tmp, tmp2, tmp3, tmp4, tmp5;
+     if (!dc_isar_feature(aa64_sve_f64mm, s)) {
-     TCGv_ptr ptr1, ptr2, ptr3;
+         return false;
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+     }
-     VFP_DREG_N(rn, insn);
+-    return do_zzz_data_ool(s, a, 0, gen_helper_sve2_trn_q);
-     VFP_DREG_M(rm, insn);
++    return gen_gvec_ool_arg_zzz(s, gen_helper_sve2_trn_q, a, 0);
-     size = (insn >> 20) & 3;
+ }
-+    vec_size = q ? 16 : 8;
-+    rd_ofs = neon_reg_offset(rd, 0);
+ static bool trans_TRN2_q(DisasContext *s, arg_rrr_esz *a)
-+    rn_ofs = neon_reg_offset(rn, 0);
+@@ -XXX,XX +XXX,XX @@ static bool trans_TRN2_q(DisasContext *s, arg_rrr_esz *a)
-+    rm_ofs = neon_reg_offset(rm, 0);
+     if (!dc_isar_feature(aa64_sve_f64mm, s)) {
-+
+         return false;
-     if ((insn & (1 << 23)) == 0) {
+     }
-         /* Three register same length.  */
+-    return do_zzz_data_ool(s, a, 16, gen_helper_sve2_trn_q);
-         op = ((insn >> 7) & 0x1e) | ((insn >> 4) & 1);
++    return gen_gvec_ool_arg_zzz(s, gen_helper_sve2_trn_q, a, 16);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+ }
-                                      q, rd, rn, rm);
-             }
+ /*
-             return 1;
+@@ -XXX,XX +XXX,XX @@ static bool do_sve2_zzz_ool(DisasContext *s, arg_rrr_esz *a,
-+
+     if (!dc_isar_feature(aa64_sve2, s)) {
-+        case NEON_3R_LOGIC: /* Logic ops.  */
+         return false;
-+            switch ((u << 2) | size) {
+     }
-+            case 0: /* VAND */
+-    return gen_gvec_ool_zzz(s, fn, a->rd, a->rn, a->rm, 0);
-+                tcg_gen_gvec_and(0, rd_ofs, rn_ofs, rm_ofs,
++    return gen_gvec_ool_arg_zzz(s, fn, a, 0);
-+                                 vec_size, vec_size);
+ }
-+                break;
-+            case 1: /* VBIC */
+ static bool trans_SMULH_zzz(DisasContext *s, arg_rrr_esz *a)
-+                tcg_gen_gvec_andc(0, rd_ofs, rn_ofs, rm_ofs,
+@@ -XXX,XX +XXX,XX @@ static bool do_aese(DisasContext *s, arg_rrr_esz *a, bool decrypt)
-+                                  vec_size, vec_size);
+     if (!dc_isar_feature(aa64_sve2_aes, s)) {
-+                break;
+         return false;
-+            case 2:
+     }
-+                if (rn == rm) {
+-    return gen_gvec_ool_zzz(s, gen_helper_crypto_aese,
-+                    /* VMOV */
+-                            a->rd, a->rn, a->rm, decrypt);
-+                    tcg_gen_gvec_mov(0, rd_ofs, rn_ofs, vec_size, vec_size);
++    return gen_gvec_ool_arg_zzz(s, gen_helper_crypto_aese, a, decrypt);
-+                } else {
+ }
-+                    /* VORR */
-+                    tcg_gen_gvec_or(0, rd_ofs, rn_ofs, rm_ofs,
+ static bool trans_AESE(DisasContext *s, arg_rrr_esz *a)
-+                                    vec_size, vec_size);
+@@ -XXX,XX +XXX,XX @@ static bool do_sm4(DisasContext *s, arg_rrr_esz *a, gen_helper_gvec_3 *fn)
-+                }
+     if (!dc_isar_feature(aa64_sve2_sm4, s)) {
-+                break;
+         return false;
-+            case 3: /* VORN */
+     }
-+                tcg_gen_gvec_orc(0, rd_ofs, rn_ofs, rm_ofs,
+-    return gen_gvec_ool_zzz(s, fn, a->rd, a->rn, a->rm, 0);
-+                                 vec_size, vec_size);
++    return gen_gvec_ool_arg_zzz(s, fn, a, 0);
-+                break;
+ }
-+            case 4: /* VEOR */
-+                tcg_gen_gvec_xor(0, rd_ofs, rn_ofs, rm_ofs,
+ static bool trans_SM4E(DisasContext *s, arg_rrr_esz *a)
 +                                 vec_size, vec_size);
 +                break;
 +            case 5: /* VBSL */
 +                tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs,
 +                               vec_size, vec_size, &bsl_op);
 +                break;
 +            case 6: /* VBIT */
 +                tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs,
 +                               vec_size, vec_size, &bit_op);
 +                break;
 +            case 7: /* VBIF */
 +                tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs,
 +                               vec_size, vec_size, &bif_op);
 +                break;
 +            }
 +            return 0;
          }
 -        if (size == 3 && op != NEON_3R_LOGIC) {
 +        if (size == 3) {
              /* 64-bit element instructions. */
              for (pass = 0; pass < (q ? 2 : 1); pass++) {
                  neon_load_reg64(cpu_V0, rn + pass);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
          case NEON_3R_VRHADD:
              GEN_NEON_INTEGER_OP(rhadd);
              break;
 -        case NEON_3R_LOGIC: /* Logic ops.  */
 -            switch ((u << 2) | size) {
 -            case 0: /* VAND */
 -                tcg_gen_and_i32(tmp, tmp, tmp2);
 -                break;
 -            case 1: /* BIC */
 -                tcg_gen_andc_i32(tmp, tmp, tmp2);
 -                break;
 -            case 2: /* VORR */
 -                tcg_gen_or_i32(tmp, tmp, tmp2);
 -                break;
 -            case 3: /* VORN */
 -                tcg_gen_orc_i32(tmp, tmp, tmp2);
 -                break;
 -            case 4: /* VEOR */
 -                tcg_gen_xor_i32(tmp, tmp, tmp2);
 -                break;
 -            case 5: /* VBSL */
 -                tmp3 = neon_load_reg(rd, pass);
 -                gen_neon_bsl(tmp, tmp, tmp2, tmp3);
 -                tcg_temp_free_i32(tmp3);
 -                break;
 -            case 6: /* VBIT */
 -                tmp3 = neon_load_reg(rd, pass);
 -                gen_neon_bsl(tmp, tmp, tmp3, tmp2);
 -                tcg_temp_free_i32(tmp3);
 -                break;
 -            case 7: /* VBIF */
 -                tmp3 = neon_load_reg(rd, pass);
 -                gen_neon_bsl(tmp, tmp3, tmp, tmp2);
 -                tcg_temp_free_i32(tmp3);
 -                break;
 -            }
 -            break;
          case NEON_3R_VHSUB:
              GEN_NEON_INTEGER_OP(hsub);
              break;
 --
-.19.1
+.25.1

-New patch
+[PULL 009/117] target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zzz
+From: Richard Henderson <richard.henderson@linaro.org>
 Convert SVE translation functions using
 gen_gvec_ool_arg_zzz to TRANS_FEAT.
 Remove trivial wrappers do_aese, do_sm4.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20220527181907.189259-7-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/translate-sve.c | 165 ++++++++++---------------------------
 file changed, 45 insertions(+), 120 deletions(-)
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-sve.c
 +++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_LSL_zzi(DisasContext *s, arg_rri_esz *a)
  }
  #define DO_ZZW(NAME, name) \
 -static bool trans_##NAME##_zzw(DisasContext *s, arg_rrr_esz *a)           \
 -{                                                                         \
 -    static gen_helper_gvec_3 * const fns[4] = {                           \
 +    static gen_helper_gvec_3 * const name##_zzw_fns[4] = {                \
          gen_helper_sve_##name##_zzw_b, gen_helper_sve_##name##_zzw_h,     \
          gen_helper_sve_##name##_zzw_s, NULL                               \
      };                                                                    \
 -    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, 0);                    \
 -}
 +    TRANS_FEAT(NAME, aa64_sve, gen_gvec_ool_arg_zzz,                      \
 +               name##_zzw_fns[a->esz], a, 0)
 -DO_ZZW(ASR, asr)
 -DO_ZZW(LSR, lsr)
 -DO_ZZW(LSL, lsl)
 +DO_ZZW(ASR_zzw, asr)
 +DO_ZZW(LSR_zzw, lsr)
 +DO_ZZW(LSL_zzw, lsl)
  #undef DO_ZZW
@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_2 * const fexpa_fns[4] = {
  TRANS_FEAT(FEXPA, aa64_sve, gen_gvec_ool_zz,
             fexpa_fns[a->esz], a->rd, a->rn, 0)
 -static bool trans_FTSSEL(DisasContext *s, arg_rrr_esz *a)
 -{
 -    static gen_helper_gvec_3 * const fns[4] = {
 -        NULL,
 -        gen_helper_sve_ftssel_h,
 -        gen_helper_sve_ftssel_s,
 -        gen_helper_sve_ftssel_d,
 -    };
 -    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, 0);
 -}
 +static gen_helper_gvec_3 * const ftssel_fns[4] = {
 +    NULL,                    gen_helper_sve_ftssel_h,
 +    gen_helper_sve_ftssel_s, gen_helper_sve_ftssel_d,
 +};
 +TRANS_FEAT(FTSSEL, aa64_sve, gen_gvec_ool_arg_zzz, ftssel_fns[a->esz], a, 0)
  /*
   *** SVE Predicate Logical Operations Group
@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_2 * const rev_fns[4] = {
  };
  TRANS_FEAT(REV_v, aa64_sve, gen_gvec_ool_zz, rev_fns[a->esz], a->rd, a->rn, 0)
 -static bool trans_TBL(DisasContext *s, arg_rrr_esz *a)
 -{
 -    static gen_helper_gvec_3 * const fns[4] = {
 -        gen_helper_sve_tbl_b, gen_helper_sve_tbl_h,
 -        gen_helper_sve_tbl_s, gen_helper_sve_tbl_d
 -    };
 -    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, 0);
 -}
 +static gen_helper_gvec_3 * const sve_tbl_fns[4] = {
 +    gen_helper_sve_tbl_b, gen_helper_sve_tbl_h,
 +    gen_helper_sve_tbl_s, gen_helper_sve_tbl_d
 +};
 +TRANS_FEAT(TBL, aa64_sve, gen_gvec_ool_arg_zzz, sve_tbl_fns[a->esz], a, 0)
  static bool trans_TBL_sve2(DisasContext *s, arg_rrr_esz *a)
  {
@@ -XXX,XX +XXX,XX @@ static bool trans_TBL_sve2(DisasContext *s, arg_rrr_esz *a)
      return true;
  }
 -static bool trans_TBX(DisasContext *s, arg_rrr_esz *a)
 -{
 -    static gen_helper_gvec_3 * const fns[4] = {
 -        gen_helper_sve2_tbx_b, gen_helper_sve2_tbx_h,
 -        gen_helper_sve2_tbx_s, gen_helper_sve2_tbx_d
 -    };
 -
 -    if (!dc_isar_feature(aa64_sve2, s)) {
 -        return false;
 -    }
 -    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, 0);
 -}
 +static gen_helper_gvec_3 * const tbx_fns[4] = {
 +    gen_helper_sve2_tbx_b, gen_helper_sve2_tbx_h,
 +    gen_helper_sve2_tbx_s, gen_helper_sve2_tbx_d
 +};
 +TRANS_FEAT(TBX, aa64_sve2, gen_gvec_ool_arg_zzz, tbx_fns[a->esz], a, 0)
  static bool trans_UNPK(DisasContext *s, arg_UNPK *a)
  {
@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_3 * const uzp_fns[4] = {
      gen_helper_sve_uzp_s, gen_helper_sve_uzp_d,
  };
 -static bool trans_UZP1_z(DisasContext *s, arg_rrr_esz *a)
 -{
 -    return gen_gvec_ool_arg_zzz(s, uzp_fns[a->esz], a, 0);
 -}
 +TRANS_FEAT(UZP1_z, aa64_sve, gen_gvec_ool_arg_zzz,
 +           uzp_fns[a->esz], a, 0)
 +TRANS_FEAT(UZP2_z, aa64_sve, gen_gvec_ool_arg_zzz,
 +           uzp_fns[a->esz], a, 1 << a->esz)
 -static bool trans_UZP2_z(DisasContext *s, arg_rrr_esz *a)
 -{
 -    return gen_gvec_ool_arg_zzz(s, uzp_fns[a->esz], a, 1 << a->esz);
 -}
 -
 -static bool trans_UZP1_q(DisasContext *s, arg_rrr_esz *a)
 -{
 -    if (!dc_isar_feature(aa64_sve_f64mm, s)) {
 -        return false;
 -    }
 -    return gen_gvec_ool_arg_zzz(s, gen_helper_sve2_uzp_q, a, 0);
 -}
 -
 -static bool trans_UZP2_q(DisasContext *s, arg_rrr_esz *a)
 -{
 -    if (!dc_isar_feature(aa64_sve_f64mm, s)) {
 -        return false;
 -    }
 -    return gen_gvec_ool_arg_zzz(s, gen_helper_sve2_uzp_q, a, 16);
 -}
 +TRANS_FEAT(UZP1_q, aa64_sve_f64mm, gen_gvec_ool_arg_zzz,
 +           gen_helper_sve2_uzp_q, a, 0)
 +TRANS_FEAT(UZP2_q, aa64_sve_f64mm, gen_gvec_ool_arg_zzz,
 +           gen_helper_sve2_uzp_q, a, 16)
  static gen_helper_gvec_3 * const trn_fns[4] = {
      gen_helper_sve_trn_b, gen_helper_sve_trn_h,
      gen_helper_sve_trn_s, gen_helper_sve_trn_d,
  };
 -static bool trans_TRN1_z(DisasContext *s, arg_rrr_esz *a)
 -{
 -    return gen_gvec_ool_arg_zzz(s, trn_fns[a->esz], a, 0);
 -}
 +TRANS_FEAT(TRN1_z, aa64_sve, gen_gvec_ool_arg_zzz,
 +           trn_fns[a->esz], a, 0)
 +TRANS_FEAT(TRN2_z, aa64_sve, gen_gvec_ool_arg_zzz,
 +           trn_fns[a->esz], a, 1 << a->esz)
 -static bool trans_TRN2_z(DisasContext *s, arg_rrr_esz *a)
 -{
 -    return gen_gvec_ool_arg_zzz(s, trn_fns[a->esz], a, 1 << a->esz);
 -}
 -
 -static bool trans_TRN1_q(DisasContext *s, arg_rrr_esz *a)
 -{
 -    if (!dc_isar_feature(aa64_sve_f64mm, s)) {
 -        return false;
 -    }
 -    return gen_gvec_ool_arg_zzz(s, gen_helper_sve2_trn_q, a, 0);
 -}
 -
 -static bool trans_TRN2_q(DisasContext *s, arg_rrr_esz *a)
 -{
 -    if (!dc_isar_feature(aa64_sve_f64mm, s)) {
 -        return false;
 -    }
 -    return gen_gvec_ool_arg_zzz(s, gen_helper_sve2_trn_q, a, 16);
 -}
 +TRANS_FEAT(TRN1_q, aa64_sve_f64mm, gen_gvec_ool_arg_zzz,
 +           gen_helper_sve2_trn_q, a, 0)
 +TRANS_FEAT(TRN2_q, aa64_sve_f64mm, gen_gvec_ool_arg_zzz,
 +           gen_helper_sve2_trn_q, a, 16)
  /*
   *** SVE Permute Vector - Predicated Group
@@ -XXX,XX +XXX,XX @@ static bool trans_USDOT_zzzz(DisasContext *s, arg_USDOT_zzzz *a)
  TRANS_FEAT(AESMC, aa64_sve2_aes, gen_gvec_ool_zz,
             gen_helper_crypto_aesmc, a->rd, a->rd, a->decrypt)
 -static bool do_aese(DisasContext *s, arg_rrr_esz *a, bool decrypt)
 -{
 -    if (!dc_isar_feature(aa64_sve2_aes, s)) {
 -        return false;
 -    }
 -    return gen_gvec_ool_arg_zzz(s, gen_helper_crypto_aese, a, decrypt);
 -}
 +TRANS_FEAT(AESE, aa64_sve2_aes, gen_gvec_ool_arg_zzz,
 +           gen_helper_crypto_aese, a, false)
 +TRANS_FEAT(AESD, aa64_sve2_aes, gen_gvec_ool_arg_zzz,
 +           gen_helper_crypto_aese, a, true)
 -static bool trans_AESE(DisasContext *s, arg_rrr_esz *a)
 -{
 -    return do_aese(s, a, false);
 -}
 -
 -static bool trans_AESD(DisasContext *s, arg_rrr_esz *a)
 -{
 -    return do_aese(s, a, true);
 -}
 -
 -static bool do_sm4(DisasContext *s, arg_rrr_esz *a, gen_helper_gvec_3 *fn)
 -{
 -    if (!dc_isar_feature(aa64_sve2_sm4, s)) {
 -        return false;
 -    }
 -    return gen_gvec_ool_arg_zzz(s, fn, a, 0);
 -}
 -
 -static bool trans_SM4E(DisasContext *s, arg_rrr_esz *a)
 -{
 -    return do_sm4(s, a, gen_helper_crypto_sm4e);
 -}
 -
 -static bool trans_SM4EKEY(DisasContext *s, arg_rrr_esz *a)
 -{
 -    return do_sm4(s, a, gen_helper_crypto_sm4ekey);
 -}
 +TRANS_FEAT(SM4E, aa64_sve2_sm4, gen_gvec_ool_arg_zzz,
 +           gen_helper_crypto_sm4e, a, 0)
 +TRANS_FEAT(SM4EKEY, aa64_sve2_sm4, gen_gvec_ool_arg_zzz,
 +           gen_helper_crypto_sm4ekey, a, 0)
  static bool trans_RAX1(DisasContext *s, arg_rrr_esz *a)
  {
 --
 .25.1

-New patch
+[PULL 010/117] target/arm: Use TRANS_FEAT for do_sve2_zzz_ool
+From: Richard Henderson <richard.henderson@linaro.org>
+Convert SVE translation functions using do_sve2_zzz_ool
+to use TRANS_FEAT and gen_gvec_ool_arg_zzz.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-8-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 88 ++++++++++++++------------------------
+file changed, 31 insertions(+), 57 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool trans_MUL_zzz(DisasContext *s, arg_rrr_esz *a)
+     return true;
+ }
+-static bool do_sve2_zzz_ool(DisasContext *s, arg_rrr_esz *a,
+-                            gen_helper_gvec_3 *fn)
+-{
+-    if (!dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_arg_zzz(s, fn, a, 0);
+-}
++static gen_helper_gvec_3 * const smulh_zzz_fns[4] = {
++    gen_helper_gvec_smulh_b, gen_helper_gvec_smulh_h,
++    gen_helper_gvec_smulh_s, gen_helper_gvec_smulh_d,
++};
++TRANS_FEAT(SMULH_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
++           smulh_zzz_fns[a->esz], a, 0)
+-static bool trans_SMULH_zzz(DisasContext *s, arg_rrr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_gvec_smulh_b, gen_helper_gvec_smulh_h,
+-        gen_helper_gvec_smulh_s, gen_helper_gvec_smulh_d,
+-    };
+-    return do_sve2_zzz_ool(s, a, fns[a->esz]);
+-}
++static gen_helper_gvec_3 * const umulh_zzz_fns[4] = {
++    gen_helper_gvec_umulh_b, gen_helper_gvec_umulh_h,
++    gen_helper_gvec_umulh_s, gen_helper_gvec_umulh_d,
++};
++TRANS_FEAT(UMULH_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
++           umulh_zzz_fns[a->esz], a, 0)
+-static bool trans_UMULH_zzz(DisasContext *s, arg_rrr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_gvec_umulh_b, gen_helper_gvec_umulh_h,
+-        gen_helper_gvec_umulh_s, gen_helper_gvec_umulh_d,
+-    };
+-    return do_sve2_zzz_ool(s, a, fns[a->esz]);
+-}
++TRANS_FEAT(PMUL_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
++           gen_helper_gvec_pmul_b, a, 0)
+-static bool trans_PMUL_zzz(DisasContext *s, arg_rrr_esz *a)
+-{
+-    return do_sve2_zzz_ool(s, a, gen_helper_gvec_pmul_b);
+-}
++static gen_helper_gvec_3 * const sqdmulh_zzz_fns[4] = {
++    gen_helper_sve2_sqdmulh_b, gen_helper_sve2_sqdmulh_h,
++    gen_helper_sve2_sqdmulh_s, gen_helper_sve2_sqdmulh_d,
++};
++TRANS_FEAT(SQDMULH_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
++           sqdmulh_zzz_fns[a->esz], a, 0)
+-static bool trans_SQDMULH_zzz(DisasContext *s, arg_rrr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve2_sqdmulh_b, gen_helper_sve2_sqdmulh_h,
+-        gen_helper_sve2_sqdmulh_s, gen_helper_sve2_sqdmulh_d,
+-    };
+-    return do_sve2_zzz_ool(s, a, fns[a->esz]);
+-}
+-
+-static bool trans_SQRDMULH_zzz(DisasContext *s, arg_rrr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve2_sqrdmulh_b, gen_helper_sve2_sqrdmulh_h,
+-        gen_helper_sve2_sqrdmulh_s, gen_helper_sve2_sqrdmulh_d,
+-    };
+-    return do_sve2_zzz_ool(s, a, fns[a->esz]);
+-}
++static gen_helper_gvec_3 * const sqrdmulh_zzz_fns[4] = {
++    gen_helper_sve2_sqrdmulh_b, gen_helper_sve2_sqrdmulh_h,
++    gen_helper_sve2_sqrdmulh_s, gen_helper_sve2_sqrdmulh_d,
++};
++TRANS_FEAT(SQRDMULH_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
++           sqrdmulh_zzz_fns[a->esz], a, 0)
+ /*
+  * SVE2 Integer - Predicated
+@@ -XXX,XX +XXX,XX @@ static bool trans_UQRSHRNT(DisasContext *s, arg_rri_esz *a)
+ }
+ #define DO_SVE2_ZZZ_NARROW(NAME, name)                                    \
+-static bool trans_##NAME(DisasContext *s, arg_rrr_esz *a)                 \
+-{                                                                         \
+-    static gen_helper_gvec_3 * const fns[4] = {                           \
++    static gen_helper_gvec_3 * const name##_fns[4] = {                    \
+         NULL,                       gen_helper_sve2_##name##_h,           \
+         gen_helper_sve2_##name##_s, gen_helper_sve2_##name##_d,           \
+     };                                                                    \
+-    return do_sve2_zzz_ool(s, a, fns[a->esz]);                            \
+-}
++    TRANS_FEAT(NAME, aa64_sve2, gen_gvec_ool_arg_zzz,                     \
++               name##_fns[a->esz], a, 0)
+ DO_SVE2_ZZZ_NARROW(ADDHNB, addhnb)
+ DO_SVE2_ZZZ_NARROW(ADDHNT, addhnt)
+@@ -XXX,XX +XXX,XX @@ static bool trans_HISTCNT(DisasContext *s, arg_rprr_esz *a)
+     return do_sve2_zpzz_ool(s, a, fns[a->esz - 2]);
+ }
+-static bool trans_HISTSEG(DisasContext *s, arg_rrr_esz *a)
+-{
+-    if (a->esz != 0) {
+-        return false;
+-    }
+-    return do_sve2_zzz_ool(s, a, gen_helper_sve2_histseg);
+-}
++TRANS_FEAT(HISTSEG, aa64_sve2, gen_gvec_ool_arg_zzz,
++           a->esz == 0 ? gen_helper_sve2_histseg : NULL, a, 0)
+ static bool do_sve2_zpzz_fp(DisasContext *s, arg_rprr_esz *a,
+                             gen_helper_gvec_4_ptr *fn)
+--
+.25.1

-New patch
+[PULL 011/117] target/arm: Move null function and sve check into gen_gvec_ool_zzzz
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-9-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 102 ++++++++++++++-----------------------
+file changed, 38 insertions(+), 64 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_arg_zzz(DisasContext *s, gen_helper_gvec_3 *fn,
+ }
+ /* Invoke an out-of-line helper on 4 Zregs. */
+-static void gen_gvec_ool_zzzz(DisasContext *s, gen_helper_gvec_4 *fn,
++static bool gen_gvec_ool_zzzz(DisasContext *s, gen_helper_gvec_4 *fn,
+                               int rd, int rn, int rm, int ra, int data)
+ {
+-    unsigned vsz = vec_full_reg_size(s);
+-    tcg_gen_gvec_4_ool(vec_full_reg_offset(s, rd),
+-                       vec_full_reg_offset(s, rn),
+-                       vec_full_reg_offset(s, rm),
+-                       vec_full_reg_offset(s, ra),
+-                       vsz, vsz, data, fn);
++    if (fn == NULL) {
++        return false;
++    }
++    if (sve_access_check(s)) {
++        unsigned vsz = vec_full_reg_size(s);
++        tcg_gen_gvec_4_ool(vec_full_reg_offset(s, rd),
++                           vec_full_reg_offset(s, rn),
++                           vec_full_reg_offset(s, rm),
++                           vec_full_reg_offset(s, ra),
++                           vsz, vsz, data, fn);
++    }
++    return true;
+ }
+ /* Invoke an out-of-line helper on 2 Zregs and a predicate. */
+@@ -XXX,XX +XXX,XX @@ static bool trans_TBL_sve2(DisasContext *s, arg_rrr_esz *a)
+     if (!dc_isar_feature(aa64_sve2, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzzz(s, fns[a->esz], a->rd, a->rn,
+-                          (a->rn + 1) % 32, a->rm, 0);
+-    }
+-    return true;
++    return gen_gvec_ool_zzzz(s, fns[a->esz], a->rd, a->rn,
++                             (a->rn + 1) % 32, a->rm, 0);
+ }
+ static gen_helper_gvec_3 * const tbx_fns[4] = {
+@@ -XXX,XX +XXX,XX @@ static bool trans_DOT_zzzz(DisasContext *s, arg_DOT_zzzz *a)
+         { gen_helper_gvec_sdot_b, gen_helper_gvec_sdot_h },
+         { gen_helper_gvec_udot_b, gen_helper_gvec_udot_h }
+     };
+-
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzzz(s, fns[a->u][a->sz], a->rd, a->rn, a->rm, a->ra, 0);
+-    }
+-    return true;
++    return gen_gvec_ool_zzzz(s, fns[a->u][a->sz],
++                             a->rd, a->rn, a->rm, a->ra, 0);
+ }
+ /*
+@@ -XXX,XX +XXX,XX @@ static bool trans_DOT_zzzz(DisasContext *s, arg_DOT_zzzz *a)
+ static bool do_zzxz_ool(DisasContext *s, arg_rrxr_esz *a,
+                         gen_helper_gvec_4 *fn)
+ {
+-    if (fn == NULL) {
+-        return false;
+-    }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzzz(s, fn, a->rd, a->rn, a->rm, a->ra, a->index);
+-    }
+-    return true;
++    return gen_gvec_ool_zzzz(s, fn, a->rd, a->rn, a->rm, a->ra, a->index);
+ }
+ #define DO_RRXR(NAME, FUNC) \
+@@ -XXX,XX +XXX,XX @@ static bool trans_SQCADD_rot270(DisasContext *s, arg_rrr_esz *a)
+ static bool do_sve2_zzzz_ool(DisasContext *s, arg_rrrr_esz *a,
+                              gen_helper_gvec_4 *fn, int data)
+ {
+-    if (fn == NULL || !dc_isar_feature(aa64_sve2, s)) {
++    if (!dc_isar_feature(aa64_sve2, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzzz(s, fn, a->rd, a->rn, a->rm, a->ra, data);
+-    }
+-    return true;
++    return gen_gvec_ool_zzzz(s, fn, a->rd, a->rn, a->rm, a->ra, data);
+ }
+ static bool do_abal(DisasContext *s, arg_rrrr_esz *a, bool uns, bool sel)
+@@ -XXX,XX +XXX,XX @@ static bool trans_CMLA_zzzz(DisasContext *s, arg_CMLA_zzzz *a)
+     if (!dc_isar_feature(aa64_sve2, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzzz(s, fns[a->esz], a->rd, a->rn, a->rm, a->ra, a->rot);
+-    }
+-    return true;
++    return gen_gvec_ool_zzzz(s, fns[a->esz], a->rd, a->rn,
++                             a->rm, a->ra, a->rot);
+ }
+ static bool trans_CDOT_zzzz(DisasContext *s, arg_CMLA_zzzz *a)
+ {
+-    if (!dc_isar_feature(aa64_sve2, s) || a->esz < MO_32) {
++    static gen_helper_gvec_4 * const fns[] = {
++        NULL, NULL, gen_helper_sve2_cdot_zzzz_s, gen_helper_sve2_cdot_zzzz_d
++    };
++
++    if (!dc_isar_feature(aa64_sve2, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_helper_gvec_4 *fn = (a->esz == MO_32
+-                                 ? gen_helper_sve2_cdot_zzzz_s
+-                                 : gen_helper_sve2_cdot_zzzz_d);
+-        gen_gvec_ool_zzzz(s, fn, a->rd, a->rn, a->rm, a->ra, a->rot);
+-    }
+-    return true;
++    return gen_gvec_ool_zzzz(s, fns[a->esz], a->rd, a->rn,
++                             a->rm, a->ra, a->rot);
+ }
+ static bool trans_SQRDCMLAH_zzzz(DisasContext *s, arg_SQRDCMLAH_zzzz *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_SQRDCMLAH_zzzz(DisasContext *s, arg_SQRDCMLAH_zzzz *a)
+     if (!dc_isar_feature(aa64_sve2, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzzz(s, fns[a->esz], a->rd, a->rn, a->rm, a->ra, a->rot);
+-    }
+-    return true;
++    return gen_gvec_ool_zzzz(s, fns[a->esz], a->rd, a->rn,
++                             a->rm, a->ra, a->rot);
+ }
+ static bool trans_USDOT_zzzz(DisasContext *s, arg_USDOT_zzzz *a)
+@@ -XXX,XX +XXX,XX @@ static bool do_i8mm_zzzz_ool(DisasContext *s, arg_rrrr_esz *a,
+     if (!dc_isar_feature(aa64_sve_i8mm, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzzz(s, fn, a->rd, a->rn, a->rm, a->ra, data);
+-    }
+-    return true;
++    return gen_gvec_ool_zzzz(s, fn, a->rd, a->rn, a->rm, a->ra, data);
+ }
+ static bool trans_SMMLA(DisasContext *s, arg_rrrr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_BFDOT_zzzz(DisasContext *s, arg_rrrr_esz *a)
+     if (!dc_isar_feature(aa64_sve_bf16, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzzz(s, gen_helper_gvec_bfdot,
+-                          a->rd, a->rn, a->rm, a->ra, 0);
+-    }
+-    return true;
++    return gen_gvec_ool_zzzz(s, gen_helper_gvec_bfdot,
++                             a->rd, a->rn, a->rm, a->ra, 0);
+ }
+ static bool trans_BFDOT_zzxz(DisasContext *s, arg_rrxr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_BFDOT_zzxz(DisasContext *s, arg_rrxr_esz *a)
+     if (!dc_isar_feature(aa64_sve_bf16, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzzz(s, gen_helper_gvec_bfdot_idx,
+-                          a->rd, a->rn, a->rm, a->ra, a->index);
+-    }
+-    return true;
++    return gen_gvec_ool_zzzz(s, gen_helper_gvec_bfdot_idx,
++                             a->rd, a->rn, a->rm, a->ra, a->index);
+ }
+ static bool trans_BFMMLA(DisasContext *s, arg_rrrr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_BFMMLA(DisasContext *s, arg_rrrr_esz *a)
+     if (!dc_isar_feature(aa64_sve_bf16, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzzz(s, gen_helper_gvec_bfmmla,
+-                          a->rd, a->rn, a->rm, a->ra, 0);
+-    }
+-    return true;
++    return gen_gvec_ool_zzzz(s, gen_helper_gvec_bfmmla,
++                             a->rd, a->rn, a->rm, a->ra, 0);
+ }
+ static bool do_BFMLAL_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sel)
+--
+.25.1

-New patch
+[PULL 012/117] target/arm: Use TRANS_FEAT for gen_gvec_ool_zzzz
+From: Richard Henderson <richard.henderson@linaro.org>
+Convert SVE translation functions directly using
+gen_gvec_ool_zzzz to TRANS_FEAT.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-10-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 89 +++++++++++++-------------------------
+file changed, 29 insertions(+), 60 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_3 * const sve_tbl_fns[4] = {
+ };
+ TRANS_FEAT(TBL, aa64_sve, gen_gvec_ool_arg_zzz, sve_tbl_fns[a->esz], a, 0)
+-static bool trans_TBL_sve2(DisasContext *s, arg_rrr_esz *a)
+-{
+-    static gen_helper_gvec_4 * const fns[4] = {
+-        gen_helper_sve2_tbl_b, gen_helper_sve2_tbl_h,
+-        gen_helper_sve2_tbl_s, gen_helper_sve2_tbl_d
+-    };
+-
+-    if (!dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_zzzz(s, fns[a->esz], a->rd, a->rn,
+-                             (a->rn + 1) % 32, a->rm, 0);
+-}
++static gen_helper_gvec_4 * const sve2_tbl_fns[4] = {
++    gen_helper_sve2_tbl_b, gen_helper_sve2_tbl_h,
++    gen_helper_sve2_tbl_s, gen_helper_sve2_tbl_d
++};
++TRANS_FEAT(TBL_sve2, aa64_sve2, gen_gvec_ool_zzzz, sve2_tbl_fns[a->esz],
++           a->rd, a->rn, (a->rn + 1) % 32, a->rm, 0)
+ static gen_helper_gvec_3 * const tbx_fns[4] = {
+     gen_helper_sve2_tbx_b, gen_helper_sve2_tbx_h,
+@@ -XXX,XX +XXX,XX @@ DO_ZZI(UMIN, umin)
+ #undef DO_ZZI
+-static bool trans_DOT_zzzz(DisasContext *s, arg_DOT_zzzz *a)
+-{
+-    static gen_helper_gvec_4 * const fns[2][2] = {
+-        { gen_helper_gvec_sdot_b, gen_helper_gvec_sdot_h },
+-        { gen_helper_gvec_udot_b, gen_helper_gvec_udot_h }
+-    };
+-    return gen_gvec_ool_zzzz(s, fns[a->u][a->sz],
+-                             a->rd, a->rn, a->rm, a->ra, 0);
+-}
++static gen_helper_gvec_4 * const dot_fns[2][2] = {
++    { gen_helper_gvec_sdot_b, gen_helper_gvec_sdot_h },
++    { gen_helper_gvec_udot_b, gen_helper_gvec_udot_h }
++};
++TRANS_FEAT(DOT_zzzz, aa64_sve, gen_gvec_ool_zzzz,
++           dot_fns[a->u][a->sz], a->rd, a->rn, a->rm, a->ra, 0)
+ /*
+  * SVE Multiply - Indexed
+@@ -XXX,XX +XXX,XX @@ static bool trans_UMLSLT_zzzw(DisasContext *s, arg_rrrr_esz *a)
+     return do_umlsl_zzzw(s, a, true);
+ }
+-static bool trans_CMLA_zzzz(DisasContext *s, arg_CMLA_zzzz *a)
+-{
+-    static gen_helper_gvec_4 * const fns[] = {
+-        gen_helper_sve2_cmla_zzzz_b, gen_helper_sve2_cmla_zzzz_h,
+-        gen_helper_sve2_cmla_zzzz_s, gen_helper_sve2_cmla_zzzz_d,
+-    };
++static gen_helper_gvec_4 * const cmla_fns[] = {
++    gen_helper_sve2_cmla_zzzz_b, gen_helper_sve2_cmla_zzzz_h,
++    gen_helper_sve2_cmla_zzzz_s, gen_helper_sve2_cmla_zzzz_d,
++};
++TRANS_FEAT(CMLA_zzzz, aa64_sve2, gen_gvec_ool_zzzz,
++           cmla_fns[a->esz], a->rd, a->rn, a->rm, a->ra, a->rot)
+-    if (!dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_zzzz(s, fns[a->esz], a->rd, a->rn,
+-                             a->rm, a->ra, a->rot);
+-}
++static gen_helper_gvec_4 * const cdot_fns[] = {
++    NULL, NULL, gen_helper_sve2_cdot_zzzz_s, gen_helper_sve2_cdot_zzzz_d
++};
++TRANS_FEAT(CDOT_zzzz, aa64_sve2, gen_gvec_ool_zzzz,
++           cdot_fns[a->esz], a->rd, a->rn, a->rm, a->ra, a->rot)
+-static bool trans_CDOT_zzzz(DisasContext *s, arg_CMLA_zzzz *a)
+-{
+-    static gen_helper_gvec_4 * const fns[] = {
+-        NULL, NULL, gen_helper_sve2_cdot_zzzz_s, gen_helper_sve2_cdot_zzzz_d
+-    };
+-
+-    if (!dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_zzzz(s, fns[a->esz], a->rd, a->rn,
+-                             a->rm, a->ra, a->rot);
+-}
+-
+-static bool trans_SQRDCMLAH_zzzz(DisasContext *s, arg_SQRDCMLAH_zzzz *a)
+-{
+-    static gen_helper_gvec_4 * const fns[] = {
+-        gen_helper_sve2_sqrdcmlah_zzzz_b, gen_helper_sve2_sqrdcmlah_zzzz_h,
+-        gen_helper_sve2_sqrdcmlah_zzzz_s, gen_helper_sve2_sqrdcmlah_zzzz_d,
+-    };
+-
+-    if (!dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_zzzz(s, fns[a->esz], a->rd, a->rn,
+-                             a->rm, a->ra, a->rot);
+-}
++static gen_helper_gvec_4 * const sqrdcmlah_fns[] = {
++    gen_helper_sve2_sqrdcmlah_zzzz_b, gen_helper_sve2_sqrdcmlah_zzzz_h,
++    gen_helper_sve2_sqrdcmlah_zzzz_s, gen_helper_sve2_sqrdcmlah_zzzz_d,
++};
++TRANS_FEAT(SQRDCMLAH_zzzz, aa64_sve2, gen_gvec_ool_zzzz,
++           sqrdcmlah_fns[a->esz], a->rd, a->rn, a->rm, a->ra, a->rot)
+ static bool trans_USDOT_zzzz(DisasContext *s, arg_USDOT_zzzz *a)
+ {
+--
+.25.1

-New patch
+[PULL 013/117] target/arm: Introduce gen_gvec_ool_arg_zzzz
+From: Richard Henderson <richard.henderson@linaro.org>
+Use gen_gvec_ool_arg_zzzz instead of gen_gvec_ool_zzzz
+when the arguments come from arg_rrrr_esz.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-11-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 16 ++++++++++------
+file changed, 10 insertions(+), 6 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_zzzz(DisasContext *s, gen_helper_gvec_4 *fn,
+     return true;
+ }
++static bool gen_gvec_ool_arg_zzzz(DisasContext *s, gen_helper_gvec_4 *fn,
++                                  arg_rrrr_esz *a, int data)
++{
++    return gen_gvec_ool_zzzz(s, fn, a->rd, a->rn, a->rm, a->ra, data);
++}
++
+ /* Invoke an out-of-line helper on 2 Zregs and a predicate. */
+ static void gen_gvec_ool_zzp(DisasContext *s, gen_helper_gvec_3 *fn,
+                              int rd, int rn, int pg, int data)
+@@ -XXX,XX +XXX,XX @@ static bool do_sve2_zzzz_ool(DisasContext *s, arg_rrrr_esz *a,
+     if (!dc_isar_feature(aa64_sve2, s)) {
+         return false;
+     }
+-    return gen_gvec_ool_zzzz(s, fn, a->rd, a->rn, a->rm, a->ra, data);
++    return gen_gvec_ool_arg_zzzz(s, fn, a, data);
+ }
+ static bool do_abal(DisasContext *s, arg_rrrr_esz *a, bool uns, bool sel)
+@@ -XXX,XX +XXX,XX @@ static bool do_i8mm_zzzz_ool(DisasContext *s, arg_rrrr_esz *a,
+     if (!dc_isar_feature(aa64_sve_i8mm, s)) {
+         return false;
+     }
+-    return gen_gvec_ool_zzzz(s, fn, a->rd, a->rn, a->rm, a->ra, data);
++    return gen_gvec_ool_arg_zzzz(s, fn, a, data);
+ }
+ static bool trans_SMMLA(DisasContext *s, arg_rrrr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_BFDOT_zzzz(DisasContext *s, arg_rrrr_esz *a)
+     if (!dc_isar_feature(aa64_sve_bf16, s)) {
+         return false;
+     }
+-    return gen_gvec_ool_zzzz(s, gen_helper_gvec_bfdot,
+-                             a->rd, a->rn, a->rm, a->ra, 0);
++    return gen_gvec_ool_arg_zzzz(s, gen_helper_gvec_bfdot, a, 0);
+ }
+ static bool trans_BFDOT_zzxz(DisasContext *s, arg_rrxr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_BFMMLA(DisasContext *s, arg_rrrr_esz *a)
+     if (!dc_isar_feature(aa64_sve_bf16, s)) {
+         return false;
+     }
+-    return gen_gvec_ool_zzzz(s, gen_helper_gvec_bfmmla,
+-                             a->rd, a->rn, a->rm, a->ra, 0);
++    return gen_gvec_ool_arg_zzzz(s, gen_helper_gvec_bfmmla, a, 0);
+ }
+ static bool do_BFMLAL_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sel)
+--
+.25.1

-New patch
+[PULL 014/117] target/arm: Use TRANS_FEAT for do_sve2_zzzz_ool
+From: Richard Henderson <richard.henderson@linaro.org>
+Convert SVE translation functions using do_sve2_zzzz_ool
+to use TRANS_FEAT and gen_gvec_ool_arg_zzzz.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-12-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 263 +++++++++++--------------------------
+file changed, 79 insertions(+), 184 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool trans_SQCADD_rot270(DisasContext *s, arg_rrr_esz *a)
+     return do_cadd(s, a, true, true);
+ }
+-static bool do_sve2_zzzz_ool(DisasContext *s, arg_rrrr_esz *a,
+-                             gen_helper_gvec_4 *fn, int data)
+-{
+-    if (!dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_arg_zzzz(s, fn, a, data);
+-}
++static gen_helper_gvec_4 * const sabal_fns[4] = {
++    NULL,                    gen_helper_sve2_sabal_h,
++    gen_helper_sve2_sabal_s, gen_helper_sve2_sabal_d,
++};
++TRANS_FEAT(SABALB, aa64_sve2, gen_gvec_ool_arg_zzzz, sabal_fns[a->esz], a, 0)
++TRANS_FEAT(SABALT, aa64_sve2, gen_gvec_ool_arg_zzzz, sabal_fns[a->esz], a, 1)
+-static bool do_abal(DisasContext *s, arg_rrrr_esz *a, bool uns, bool sel)
+-{
+-    static gen_helper_gvec_4 * const fns[2][4] = {
+-        { NULL,                    gen_helper_sve2_sabal_h,
+-          gen_helper_sve2_sabal_s, gen_helper_sve2_sabal_d },
+-        { NULL,                    gen_helper_sve2_uabal_h,
+-          gen_helper_sve2_uabal_s, gen_helper_sve2_uabal_d },
+-    };
+-    return do_sve2_zzzz_ool(s, a, fns[uns][a->esz], sel);
+-}
+-
+-static bool trans_SABALB(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_abal(s, a, false, false);
+-}
+-
+-static bool trans_SABALT(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_abal(s, a, false, true);
+-}
+-
+-static bool trans_UABALB(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_abal(s, a, true, false);
+-}
+-
+-static bool trans_UABALT(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_abal(s, a, true, true);
+-}
++static gen_helper_gvec_4 * const uabal_fns[4] = {
++    NULL,                    gen_helper_sve2_uabal_h,
++    gen_helper_sve2_uabal_s, gen_helper_sve2_uabal_d,
++};
++TRANS_FEAT(UABALB, aa64_sve2, gen_gvec_ool_arg_zzzz, uabal_fns[a->esz], a, 0)
++TRANS_FEAT(UABALT, aa64_sve2, gen_gvec_ool_arg_zzzz, uabal_fns[a->esz], a, 1)
+ static bool do_adcl(DisasContext *s, arg_rrrr_esz *a, bool sel)
+ {
+@@ -XXX,XX +XXX,XX @@ static bool do_adcl(DisasContext *s, arg_rrrr_esz *a, bool sel)
+      * Note that in this case the ESZ field encodes both size and sign.
+      * Split out 'subtract' into bit 1 of the data field for the helper.
+      */
+-    return do_sve2_zzzz_ool(s, a, fns[a->esz & 1], (a->esz & 2) | sel);
++    return gen_gvec_ool_arg_zzzz(s, fns[a->esz & 1], a, (a->esz & 2) | sel);
+ }
+-static bool trans_ADCLB(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_adcl(s, a, false);
+-}
+-
+-static bool trans_ADCLT(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_adcl(s, a, true);
+-}
++TRANS_FEAT(ADCLB, aa64_sve2, do_adcl, a, false)
++TRANS_FEAT(ADCLT, aa64_sve2, do_adcl, a, true)
+ static bool do_sve2_fn2i(DisasContext *s, arg_rri_esz *a, GVecGen2iFn *fn)
+ {
+@@ -XXX,XX +XXX,XX @@ static bool trans_FMMLA(DisasContext *s, arg_rrrr_esz *a)
+     return true;
+ }
+-static bool do_sqdmlal_zzzw(DisasContext *s, arg_rrrr_esz *a,
+-                            bool sel1, bool sel2)
+-{
+-    static gen_helper_gvec_4 * const fns[] = {
+-        NULL,                           gen_helper_sve2_sqdmlal_zzzw_h,
+-        gen_helper_sve2_sqdmlal_zzzw_s, gen_helper_sve2_sqdmlal_zzzw_d,
+-    };
+-    return do_sve2_zzzz_ool(s, a, fns[a->esz], (sel2 << 1) | sel1);
+-}
++static gen_helper_gvec_4 * const sqdmlal_zzzw_fns[] = {
++    NULL,                           gen_helper_sve2_sqdmlal_zzzw_h,
++    gen_helper_sve2_sqdmlal_zzzw_s, gen_helper_sve2_sqdmlal_zzzw_d,
++};
++TRANS_FEAT(SQDMLALB_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
++           sqdmlal_zzzw_fns[a->esz], a, 0)
++TRANS_FEAT(SQDMLALT_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
++           sqdmlal_zzzw_fns[a->esz], a, 3)
++TRANS_FEAT(SQDMLALBT, aa64_sve2, gen_gvec_ool_arg_zzzz,
++           sqdmlal_zzzw_fns[a->esz], a, 2)
+-static bool do_sqdmlsl_zzzw(DisasContext *s, arg_rrrr_esz *a,
+-                            bool sel1, bool sel2)
+-{
+-    static gen_helper_gvec_4 * const fns[] = {
+-        NULL,                           gen_helper_sve2_sqdmlsl_zzzw_h,
+-        gen_helper_sve2_sqdmlsl_zzzw_s, gen_helper_sve2_sqdmlsl_zzzw_d,
+-    };
+-    return do_sve2_zzzz_ool(s, a, fns[a->esz], (sel2 << 1) | sel1);
+-}
++static gen_helper_gvec_4 * const sqdmlsl_zzzw_fns[] = {
++    NULL,                           gen_helper_sve2_sqdmlsl_zzzw_h,
++    gen_helper_sve2_sqdmlsl_zzzw_s, gen_helper_sve2_sqdmlsl_zzzw_d,
++};
++TRANS_FEAT(SQDMLSLB_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
++           sqdmlsl_zzzw_fns[a->esz], a, 0)
++TRANS_FEAT(SQDMLSLT_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
++           sqdmlsl_zzzw_fns[a->esz], a, 3)
++TRANS_FEAT(SQDMLSLBT, aa64_sve2, gen_gvec_ool_arg_zzzz,
++           sqdmlsl_zzzw_fns[a->esz], a, 2)
+-static bool trans_SQDMLALB_zzzw(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_sqdmlal_zzzw(s, a, false, false);
+-}
++static gen_helper_gvec_4 * const sqrdmlah_fns[] = {
++    gen_helper_sve2_sqrdmlah_b, gen_helper_sve2_sqrdmlah_h,
++    gen_helper_sve2_sqrdmlah_s, gen_helper_sve2_sqrdmlah_d,
++};
++TRANS_FEAT(SQRDMLAH_zzzz, aa64_sve2, gen_gvec_ool_arg_zzzz,
++           sqrdmlah_fns[a->esz], a, 0)
+-static bool trans_SQDMLALT_zzzw(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_sqdmlal_zzzw(s, a, true, true);
+-}
++static gen_helper_gvec_4 * const sqrdmlsh_fns[] = {
++    gen_helper_sve2_sqrdmlsh_b, gen_helper_sve2_sqrdmlsh_h,
++    gen_helper_sve2_sqrdmlsh_s, gen_helper_sve2_sqrdmlsh_d,
++};
++TRANS_FEAT(SQRDMLSH_zzzz, aa64_sve2, gen_gvec_ool_arg_zzzz,
++           sqrdmlsh_fns[a->esz], a, 0)
+-static bool trans_SQDMLALBT(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_sqdmlal_zzzw(s, a, false, true);
+-}
++static gen_helper_gvec_4 * const smlal_zzzw_fns[] = {
++    NULL,                         gen_helper_sve2_smlal_zzzw_h,
++    gen_helper_sve2_smlal_zzzw_s, gen_helper_sve2_smlal_zzzw_d,
++};
++TRANS_FEAT(SMLALB_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
++           smlal_zzzw_fns[a->esz], a, 0)
++TRANS_FEAT(SMLALT_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
++           smlal_zzzw_fns[a->esz], a, 1)
+-static bool trans_SQDMLSLB_zzzw(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_sqdmlsl_zzzw(s, a, false, false);
+-}
++static gen_helper_gvec_4 * const umlal_zzzw_fns[] = {
++    NULL,                         gen_helper_sve2_umlal_zzzw_h,
++    gen_helper_sve2_umlal_zzzw_s, gen_helper_sve2_umlal_zzzw_d,
++};
++TRANS_FEAT(UMLALB_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
++           umlal_zzzw_fns[a->esz], a, 0)
++TRANS_FEAT(UMLALT_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
++           umlal_zzzw_fns[a->esz], a, 1)
+-static bool trans_SQDMLSLT_zzzw(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_sqdmlsl_zzzw(s, a, true, true);
+-}
++static gen_helper_gvec_4 * const smlsl_zzzw_fns[] = {
++    NULL,                         gen_helper_sve2_smlsl_zzzw_h,
++    gen_helper_sve2_smlsl_zzzw_s, gen_helper_sve2_smlsl_zzzw_d,
++};
++TRANS_FEAT(SMLSLB_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
++           smlsl_zzzw_fns[a->esz], a, 0)
++TRANS_FEAT(SMLSLT_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
++           smlsl_zzzw_fns[a->esz], a, 1)
+-static bool trans_SQDMLSLBT(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_sqdmlsl_zzzw(s, a, false, true);
+-}
+-
+-static bool trans_SQRDMLAH_zzzz(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    static gen_helper_gvec_4 * const fns[] = {
+-        gen_helper_sve2_sqrdmlah_b, gen_helper_sve2_sqrdmlah_h,
+-        gen_helper_sve2_sqrdmlah_s, gen_helper_sve2_sqrdmlah_d,
+-    };
+-    return do_sve2_zzzz_ool(s, a, fns[a->esz], 0);
+-}
+-
+-static bool trans_SQRDMLSH_zzzz(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    static gen_helper_gvec_4 * const fns[] = {
+-        gen_helper_sve2_sqrdmlsh_b, gen_helper_sve2_sqrdmlsh_h,
+-        gen_helper_sve2_sqrdmlsh_s, gen_helper_sve2_sqrdmlsh_d,
+-    };
+-    return do_sve2_zzzz_ool(s, a, fns[a->esz], 0);
+-}
+-
+-static bool do_smlal_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sel)
+-{
+-    static gen_helper_gvec_4 * const fns[] = {
+-        NULL,                         gen_helper_sve2_smlal_zzzw_h,
+-        gen_helper_sve2_smlal_zzzw_s, gen_helper_sve2_smlal_zzzw_d,
+-    };
+-    return do_sve2_zzzz_ool(s, a, fns[a->esz], sel);
+-}
+-
+-static bool trans_SMLALB_zzzw(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_smlal_zzzw(s, a, false);
+-}
+-
+-static bool trans_SMLALT_zzzw(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_smlal_zzzw(s, a, true);
+-}
+-
+-static bool do_umlal_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sel)
+-{
+-    static gen_helper_gvec_4 * const fns[] = {
+-        NULL,                         gen_helper_sve2_umlal_zzzw_h,
+-        gen_helper_sve2_umlal_zzzw_s, gen_helper_sve2_umlal_zzzw_d,
+-    };
+-    return do_sve2_zzzz_ool(s, a, fns[a->esz], sel);
+-}
+-
+-static bool trans_UMLALB_zzzw(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_umlal_zzzw(s, a, false);
+-}
+-
+-static bool trans_UMLALT_zzzw(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_umlal_zzzw(s, a, true);
+-}
+-
+-static bool do_smlsl_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sel)
+-{
+-    static gen_helper_gvec_4 * const fns[] = {
+-        NULL,                         gen_helper_sve2_smlsl_zzzw_h,
+-        gen_helper_sve2_smlsl_zzzw_s, gen_helper_sve2_smlsl_zzzw_d,
+-    };
+-    return do_sve2_zzzz_ool(s, a, fns[a->esz], sel);
+-}
+-
+-static bool trans_SMLSLB_zzzw(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_smlsl_zzzw(s, a, false);
+-}
+-
+-static bool trans_SMLSLT_zzzw(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_smlsl_zzzw(s, a, true);
+-}
+-
+-static bool do_umlsl_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sel)
+-{
+-    static gen_helper_gvec_4 * const fns[] = {
+-        NULL,                         gen_helper_sve2_umlsl_zzzw_h,
+-        gen_helper_sve2_umlsl_zzzw_s, gen_helper_sve2_umlsl_zzzw_d,
+-    };
+-    return do_sve2_zzzz_ool(s, a, fns[a->esz], sel);
+-}
+-
+-static bool trans_UMLSLB_zzzw(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_umlsl_zzzw(s, a, false);
+-}
+-
+-static bool trans_UMLSLT_zzzw(DisasContext *s, arg_rrrr_esz *a)
+-{
+-    return do_umlsl_zzzw(s, a, true);
+-}
++static gen_helper_gvec_4 * const umlsl_zzzw_fns[] = {
++    NULL,                         gen_helper_sve2_umlsl_zzzw_h,
++    gen_helper_sve2_umlsl_zzzw_s, gen_helper_sve2_umlsl_zzzw_d,
++};
++TRANS_FEAT(UMLSLB_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
++           umlsl_zzzw_fns[a->esz], a, 0)
++TRANS_FEAT(UMLSLT_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
++           umlsl_zzzw_fns[a->esz], a, 1)
+ static gen_helper_gvec_4 * const cmla_fns[] = {
+     gen_helper_sve2_cmla_zzzz_b, gen_helper_sve2_cmla_zzzz_h,
+--
+.25.1

-[Qemu-devel] [PULL 37/45] target/arm: Use gvec for NEON_3R_VTST_VCEQ, NEON_3R_VCGT, NEON_3R_VCGE
+[PULL 015/117] target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zzzz
 From: Richard Henderson <richard.henderson@linaro.org>
-Move cmtst_op expanders from translate-a64.c.
+Convert SVE translation functions directly using
 gen_gvec_ool_arg_zzzz to TRANS_FEAT.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-17-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-13-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.h     |  2 +
+ target/arm/translate-sve.c | 47 ++++++++------------------------------
- target/arm/translate-a64.c | 38 ------------------
+file changed, 10 insertions(+), 37 deletions(-)
  target/arm/translate.c     | 81 +++++++++++++++++++++++++++-----------
 files changed, 60 insertions(+), 61 deletions(-)
-diff --git a/target/arm/translate.h b/target/arm/translate.h
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ extern const GVecGen3 bit_op;
+@@ -XXX,XX +XXX,XX @@ static bool trans_FMLSLT_zzxw(DisasContext *s, arg_rrxr_esz *a)
- extern const GVecGen3 bif_op;
+     return do_FMLAL_zzxw(s, a, true, true);
  extern const GVecGen3 mla_op[4];
  extern const GVecGen3 mls_op[4];
 +extern const GVecGen3 cmtst_op[4];
  extern const GVecGen2i ssra_op[4];
  extern const GVecGen2i usra_op[4];
  extern const GVecGen2i sri_op[4];
  extern const GVecGen2i sli_op[4];
 +void gen_cmtst_i64(TCGv_i64 d, TCGv_i64 a, TCGv_i64 b);
  /*
   * Forward to the isar_feature_* tests given a DisasContext pointer.
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_three_reg_diff(DisasContext *s, uint32_t insn)
      }
  }
--/* CMTST : test is "if (X & Y != 0)". */
+-static bool do_i8mm_zzzz_ool(DisasContext *s, arg_rrrr_esz *a,
--static void gen_cmtst_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
+-                             gen_helper_gvec_4 *fn, int data)
 -{
--    tcg_gen_and_i32(d, a, b);
+-    if (!dc_isar_feature(aa64_sve_i8mm, s)) {
--    tcg_gen_setcondi_i32(TCG_COND_NE, d, d, 0);
+-        return false;
--    tcg_gen_neg_i32(d, d);
+-    }
 -    return gen_gvec_ool_arg_zzzz(s, fn, a, data);
 -}
 +TRANS_FEAT(SMMLA, aa64_sve_i8mm, gen_gvec_ool_arg_zzzz,
 +           gen_helper_gvec_smmla_b, a, 0)
 +TRANS_FEAT(USMMLA, aa64_sve_i8mm, gen_gvec_ool_arg_zzzz,
 +           gen_helper_gvec_usmmla_b, a, 0)
 +TRANS_FEAT(UMMLA, aa64_sve_i8mm, gen_gvec_ool_arg_zzzz,
 +           gen_helper_gvec_ummla_b, a, 0)
 -static bool trans_SMMLA(DisasContext *s, arg_rrrr_esz *a)
 -{
 -    return do_i8mm_zzzz_ool(s, a, gen_helper_gvec_smmla_b, 0);
 -}
 -
--static void gen_cmtst_i64(TCGv_i64 d, TCGv_i64 a, TCGv_i64 b)
+-static bool trans_USMMLA(DisasContext *s, arg_rrrr_esz *a)
 -{
--    tcg_gen_and_i64(d, a, b);
+-    return do_i8mm_zzzz_ool(s, a, gen_helper_gvec_usmmla_b, 0);
 -    tcg_gen_setcondi_i64(TCG_COND_NE, d, d, 0);
 -    tcg_gen_neg_i64(d, d);
 -}
 -
--static void gen_cmtst_vec(unsigned vece, TCGv_vec d, TCGv_vec a, TCGv_vec b)
+-static bool trans_UMMLA(DisasContext *s, arg_rrrr_esz *a)
 -{
--    tcg_gen_and_vec(vece, d, a, b);
+-    return do_i8mm_zzzz_ool(s, a, gen_helper_gvec_ummla_b, 0);
 -    tcg_gen_dupi_vec(vece, a, 0);
 -    tcg_gen_cmp_vec(TCG_COND_NE, vece, d, d, a);
 -}
 -
- static void handle_3same_64(DisasContext *s, int opcode, bool u,
+-static bool trans_BFDOT_zzzz(DisasContext *s, arg_rrrr_esz *a)
-                             TCGv_i64 tcg_rd, TCGv_i64 tcg_rn, TCGv_i64 tcg_rm)
+-{
 -    if (!dc_isar_feature(aa64_sve_bf16, s)) {
 -        return false;
 -    }
 -    return gen_gvec_ool_arg_zzzz(s, gen_helper_gvec_bfdot, a, 0);
 -}
 +TRANS_FEAT(BFDOT_zzzz, aa64_sve_bf16, gen_gvec_ool_arg_zzzz,
 +           gen_helper_gvec_bfdot, a, 0)
  static bool trans_BFDOT_zzxz(DisasContext *s, arg_rrxr_esz *a)
  {
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_3same_float(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static bool trans_BFDOT_zzxz(DisasContext *s, arg_rrxr_esz *a)
- /* Integer op subgroup of C3.6.16. */
+                              a->rd, a->rn, a->rm, a->ra, a->index);
- static void disas_simd_3same_int(DisasContext *s, uint32_t insn)
+ }
 -static bool trans_BFMMLA(DisasContext *s, arg_rrrr_esz *a)
 -{
 -    if (!dc_isar_feature(aa64_sve_bf16, s)) {
 -        return false;
 -    }
 -    return gen_gvec_ool_arg_zzzz(s, gen_helper_gvec_bfmmla, a, 0);
 -}
 +TRANS_FEAT(BFMMLA, aa64_sve_bf16, gen_gvec_ool_arg_zzzz,
 +           gen_helper_gvec_bfmmla, a, 0)
  static bool do_BFMLAL_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sel)
  {
--    static const GVecGen3 cmtst_op[4] = {
--        { .fni4 = gen_helper_neon_tst_u8,
--          .fniv = gen_cmtst_vec,
--          .vece = MO_8 },
--        { .fni4 = gen_helper_neon_tst_u16,
--          .fniv = gen_cmtst_vec,
--          .vece = MO_16 },
--        { .fni4 = gen_cmtst_i32,
--          .fniv = gen_cmtst_vec,
--          .vece = MO_32 },
--        { .fni8 = gen_cmtst_i64,
--          .fniv = gen_cmtst_vec,
--          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
--          .vece = MO_64 },
--    };
--
-     int is_q = extract32(insn, 30, 1);
-     int u = extract32(insn, 29, 1);
-     int size = extract32(insn, 22, 2);
-diff --git a/target/arm/translate.c b/target/arm/translate.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
-+++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ const GVecGen3 mls_op[4] = {
-       .vece = MO_64 },
- };
-+/* CMTST : test is "if (X & Y != 0)". */
-+static void gen_cmtst_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
-+{
-+    tcg_gen_and_i32(d, a, b);
-+    tcg_gen_setcondi_i32(TCG_COND_NE, d, d, 0);
-+    tcg_gen_neg_i32(d, d);
-+}
-+
-+void gen_cmtst_i64(TCGv_i64 d, TCGv_i64 a, TCGv_i64 b)
-+{
-+    tcg_gen_and_i64(d, a, b);
-+    tcg_gen_setcondi_i64(TCG_COND_NE, d, d, 0);
-+    tcg_gen_neg_i64(d, d);
-+}
-+
-+static void gen_cmtst_vec(unsigned vece, TCGv_vec d, TCGv_vec a, TCGv_vec b)
-+{
-+    tcg_gen_and_vec(vece, d, a, b);
-+    tcg_gen_dupi_vec(vece, a, 0);
-+    tcg_gen_cmp_vec(TCG_COND_NE, vece, d, d, a);
-+}
-+
-+const GVecGen3 cmtst_op[4] = {
-+    { .fni4 = gen_helper_neon_tst_u8,
-+      .fniv = gen_cmtst_vec,
-+      .vece = MO_8 },
-+    { .fni4 = gen_helper_neon_tst_u16,
-+      .fniv = gen_cmtst_vec,
-+      .vece = MO_16 },
-+    { .fni4 = gen_cmtst_i32,
-+      .fniv = gen_cmtst_vec,
-+      .vece = MO_32 },
-+    { .fni8 = gen_cmtst_i64,
-+      .fniv = gen_cmtst_vec,
-+      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-+      .vece = MO_64 },
-+};
-+
- /* Translate a NEON data processing instruction.  Return nonzero if the
-    instruction is invalid.
-    We process data in a mixture of 32-bit and 64-bit chunks.
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-             tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs, vec_size, vec_size,
-                            u ? &mls_op[size] : &mla_op[size]);
-             return 0;
-+
-+        case NEON_3R_VTST_VCEQ:
-+            if (u) { /* VCEQ */
-+                tcg_gen_gvec_cmp(TCG_COND_EQ, size, rd_ofs, rn_ofs, rm_ofs,
-+                                 vec_size, vec_size);
-+            } else { /* VTST */
-+                tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs,
-+                               vec_size, vec_size, &cmtst_op[size]);
-+            }
-+            return 0;
-+
-+        case NEON_3R_VCGT:
-+            tcg_gen_gvec_cmp(u ? TCG_COND_GTU : TCG_COND_GT, size,
-+                             rd_ofs, rn_ofs, rm_ofs, vec_size, vec_size);
-+            return 0;
-+
-+        case NEON_3R_VCGE:
-+            tcg_gen_gvec_cmp(u ? TCG_COND_GEU : TCG_COND_GE, size,
-+                             rd_ofs, rn_ofs, rm_ofs, vec_size, vec_size);
-+            return 0;
-         }
-         if (size == 3) {
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-         case NEON_3R_VQSUB:
-             GEN_NEON_INTEGER_OP_ENV(qsub);
-             break;
--        case NEON_3R_VCGT:
--            GEN_NEON_INTEGER_OP(cgt);
--            break;
--        case NEON_3R_VCGE:
--            GEN_NEON_INTEGER_OP(cge);
--            break;
-         case NEON_3R_VSHL:
-             GEN_NEON_INTEGER_OP(shl);
-             break;
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-             tmp2 = neon_load_reg(rd, pass);
-             gen_neon_add(size, tmp, tmp2);
-             break;
--        case NEON_3R_VTST_VCEQ:
--            if (!u) { /* VTST */
--                switch (size) {
--                case 0: gen_helper_neon_tst_u8(tmp, tmp, tmp2); break;
--                case 1: gen_helper_neon_tst_u16(tmp, tmp, tmp2); break;
--                case 2: gen_helper_neon_tst_u32(tmp, tmp, tmp2); break;
--                default: abort();
--                }
--            } else { /* VCEQ */
--                switch (size) {
--                case 0: gen_helper_neon_ceq_u8(tmp, tmp, tmp2); break;
--                case 1: gen_helper_neon_ceq_u16(tmp, tmp, tmp2); break;
--                case 2: gen_helper_neon_ceq_u32(tmp, tmp, tmp2); break;
--                default: abort();
--                }
--            }
--            break;
-         case NEON_3R_VMUL:
-             /* VMUL.P8; other cases already eliminated.  */
-             gen_helper_neon_mul_p8(tmp, tmp, tmp2);
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 39/45] target/arm: Reorg NEON VLD/VST all elements
+[PULL 016/117] target/arm: Rename do_zzxz_ool to gen_gvec_ool_arg_zzxz
 From: Richard Henderson <richard.henderson@linaro.org>
-Instead of shifts and masks, use direct loads and stores from the neon
+Rename the function to match gen_gvec_ool_arg_zzzz,
-register file.  Mirror the iteration structure of the ARM pseudocode
+and move to be adjacent.
 more closely.  Correct the parameters of the VLD2 A2 insn.
 Note that this includes a bugfix for handling of the insn
 "VLD2 (multiple 2-element structures)" -- we were using an
 incorrect stride value.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-19-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-14-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 170 ++++++++++++++++++-----------------------
+ target/arm/translate-sve.c | 18 +++++++++---------
-file changed, 74 insertions(+), 96 deletions(-)
+file changed, 9 insertions(+), 9 deletions(-)
-diff --git a/target/arm/translate.c b/target/arm/translate.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static TCGv_i32 neon_load_reg(int reg, int pass)
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_arg_zzzz(DisasContext *s, gen_helper_gvec_4 *fn,
-     return tmp;
+     return gen_gvec_ool_zzzz(s, fn, a->rd, a->rn, a->rm, a->ra, data);
  }
-+static void neon_load_element64(TCGv_i64 var, int reg, int ele, TCGMemOp mop)
++static bool gen_gvec_ool_arg_zzxz(DisasContext *s, gen_helper_gvec_4 *fn,
 +                                  arg_rrxr_esz *a)
 +{
-+    long offset = neon_element_offset(reg, ele, mop & MO_SIZE);
++    return gen_gvec_ool_zzzz(s, fn, a->rd, a->rn, a->rm, a->ra, a->index);
 +
 +    switch (mop) {
 +    case MO_UB:
 +        tcg_gen_ld8u_i64(var, cpu_env, offset);
 +        break;
 +    case MO_UW:
 +        tcg_gen_ld16u_i64(var, cpu_env, offset);
 +        break;
 +    case MO_UL:
 +        tcg_gen_ld32u_i64(var, cpu_env, offset);
 +        break;
 +    case MO_Q:
 +        tcg_gen_ld_i64(var, cpu_env, offset);
 +        break;
 +    default:
 +        g_assert_not_reached();
 +    }
 +}
 +
- static void neon_store_reg(int reg, int pass, TCGv_i32 var)
+ /* Invoke an out-of-line helper on 2 Zregs and a predicate. */
- {
+ static void gen_gvec_ool_zzp(DisasContext *s, gen_helper_gvec_3 *fn,
-     tcg_gen_st_i32(var, cpu_env, neon_reg_offset(reg, pass));
+                              int rd, int rn, int pg, int data)
-     tcg_temp_free_i32(var);
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(DOT_zzzz, aa64_sve, gen_gvec_ool_zzzz,
   * SVE Multiply - Indexed
   */
 -static bool do_zzxz_ool(DisasContext *s, arg_rrxr_esz *a,
 -                        gen_helper_gvec_4 *fn)
 -{
 -    return gen_gvec_ool_zzzz(s, fn, a->rd, a->rn, a->rm, a->ra, a->index);
 -}
 -
  #define DO_RRXR(NAME, FUNC) \
      static bool NAME(DisasContext *s, arg_rrxr_esz *a)  \
 -    { return do_zzxz_ool(s, a, FUNC); }
 +    { return gen_gvec_ool_arg_zzxz(s, FUNC, a); }
  DO_RRXR(trans_SDOT_zzxw_s, gen_helper_gvec_sdot_idx_b)
  DO_RRXR(trans_SDOT_zzxw_d, gen_helper_gvec_sdot_idx_h)
@@ -XXX,XX +XXX,XX @@ static bool trans_SUDOT_zzxw_s(DisasContext *s, arg_rrxr_esz *a)
      if (!dc_isar_feature(aa64_sve_i8mm, s)) {
          return false;
      }
 -    return do_zzxz_ool(s, a, gen_helper_gvec_sudot_idx_b);
 +    return gen_gvec_ool_arg_zzxz(s, gen_helper_gvec_sudot_idx_b, a);
  }
-+static void neon_store_element64(int reg, int ele, TCGMemOp size, TCGv_i64 var)
+ static bool trans_USDOT_zzxw_s(DisasContext *s, arg_rrxr_esz *a)
-+{
+@@ -XXX,XX +XXX,XX @@ static bool trans_USDOT_zzxw_s(DisasContext *s, arg_rrxr_esz *a)
-+    long offset = neon_element_offset(reg, ele, size);
+     if (!dc_isar_feature(aa64_sve_i8mm, s)) {
-+
+         return false;
-+    switch (size) {
+     }
-+    case MO_8:
+-    return do_zzxz_ool(s, a, gen_helper_gvec_usdot_idx_b);
-+        tcg_gen_st8_i64(var, cpu_env, offset);
++    return gen_gvec_ool_arg_zzxz(s, gen_helper_gvec_usdot_idx_b, a);
-+        break;
+ }
-+    case MO_16:
-+        tcg_gen_st16_i64(var, cpu_env, offset);
+ #undef DO_RRXR
 +        break;
 +    case MO_32:
 +        tcg_gen_st32_i64(var, cpu_env, offset);
 +        break;
 +    case MO_64:
 +        tcg_gen_st_i64(var, cpu_env, offset);
 +        break;
 +    default:
 +        g_assert_not_reached();
 +    }
 +}
 +
  static inline void neon_load_reg64(TCGv_i64 var, int reg)
  {
      tcg_gen_ld_i64(var, cpu_env, vfp_reg_offset(1, reg));
@@ -XXX,XX +XXX,XX @@ static struct {
      int interleave;
      int spacing;
  } const neon_ls_element_type[11] = {
 -    {4, 4, 1},
 -    {4, 4, 2},
 +    {1, 4, 1},
 +    {1, 4, 2},
      {4, 1, 1},
 -    {4, 2, 1},
 -    {3, 3, 1},
 -    {3, 3, 2},
 +    {2, 2, 2},
 +    {1, 3, 1},
 +    {1, 3, 2},
      {3, 1, 1},
      {1, 1, 1},
 -    {2, 2, 1},
 -    {2, 2, 2},
 +    {1, 2, 1},
 +    {1, 2, 2},
      {2, 1, 1}
  };
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
      int shift;
      int n;
      int vec_size;
 +    int mmu_idx;
 +    TCGMemOp endian;
      TCGv_i32 addr;
      TCGv_i32 tmp;
      TCGv_i32 tmp2;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
      rn = (insn >> 16) & 0xf;
      rm = insn & 0xf;
      load = (insn & (1 << 21)) != 0;
 +    endian = s->be_data;
 +    mmu_idx = get_mem_index(s);
      if ((insn & (1 << 23)) == 0) {
          /* Load store all elements.  */
          op = (insn >> 8) & 0xf;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
          nregs = neon_ls_element_type[op].nregs;
          interleave = neon_ls_element_type[op].interleave;
          spacing = neon_ls_element_type[op].spacing;
 -        if (size == 3 && (interleave | spacing) != 1)
 +        if (size == 3 && (interleave | spacing) != 1) {
              return 1;
 +        }
 +        tmp64 = tcg_temp_new_i64();
          addr = tcg_temp_new_i32();
 +        tmp2 = tcg_const_i32(1 << size);
          load_reg_var(s, addr, rn);
 -        stride = (1 << size) * interleave;
          for (reg = 0; reg < nregs; reg++) {
 -            if (interleave > 2 || (interleave == 2 && nregs == 2)) {
 -                load_reg_var(s, addr, rn);
 -                tcg_gen_addi_i32(addr, addr, (1 << size) * reg);
 -            } else if (interleave == 2 && nregs == 4 && reg == 2) {
 -                load_reg_var(s, addr, rn);
 -                tcg_gen_addi_i32(addr, addr, 1 << size);
 -            }
 -            if (size == 3) {
 -                tmp64 = tcg_temp_new_i64();
 -                if (load) {
 -                    gen_aa32_ld64(s, tmp64, addr, get_mem_index(s));
 -                    neon_store_reg64(tmp64, rd);
 -                } else {
 -                    neon_load_reg64(tmp64, rd);
 -                    gen_aa32_st64(s, tmp64, addr, get_mem_index(s));
 -                }
 -                tcg_temp_free_i64(tmp64);
 -                tcg_gen_addi_i32(addr, addr, stride);
 -            } else {
 -                for (pass = 0; pass < 2; pass++) {
 -                    if (size == 2) {
 -                        if (load) {
 -                            tmp = tcg_temp_new_i32();
 -                            gen_aa32_ld32u(s, tmp, addr, get_mem_index(s));
 -                            neon_store_reg(rd, pass, tmp);
 -                        } else {
 -                            tmp = neon_load_reg(rd, pass);
 -                            gen_aa32_st32(s, tmp, addr, get_mem_index(s));
 -                            tcg_temp_free_i32(tmp);
 -                        }
 -                        tcg_gen_addi_i32(addr, addr, stride);
 -                    } else if (size == 1) {
 -                        if (load) {
 -                            tmp = tcg_temp_new_i32();
 -                            gen_aa32_ld16u(s, tmp, addr, get_mem_index(s));
 -                            tcg_gen_addi_i32(addr, addr, stride);
 -                            tmp2 = tcg_temp_new_i32();
 -                            gen_aa32_ld16u(s, tmp2, addr, get_mem_index(s));
 -                            tcg_gen_addi_i32(addr, addr, stride);
 -                            tcg_gen_shli_i32(tmp2, tmp2, 16);
 -                            tcg_gen_or_i32(tmp, tmp, tmp2);
 -                            tcg_temp_free_i32(tmp2);
 -                            neon_store_reg(rd, pass, tmp);
 -                        } else {
 -                            tmp = neon_load_reg(rd, pass);
 -                            tmp2 = tcg_temp_new_i32();
 -                            tcg_gen_shri_i32(tmp2, tmp, 16);
 -                            gen_aa32_st16(s, tmp, addr, get_mem_index(s));
 -                            tcg_temp_free_i32(tmp);
 -                            tcg_gen_addi_i32(addr, addr, stride);
 -                            gen_aa32_st16(s, tmp2, addr, get_mem_index(s));
 -                            tcg_temp_free_i32(tmp2);
 -                            tcg_gen_addi_i32(addr, addr, stride);
 -                        }
 -                    } else /* size == 0 */ {
 -                        if (load) {
 -                            tmp2 = NULL;
 -                            for (n = 0; n < 4; n++) {
 -                                tmp = tcg_temp_new_i32();
 -                                gen_aa32_ld8u(s, tmp, addr, get_mem_index(s));
 -                                tcg_gen_addi_i32(addr, addr, stride);
 -                                if (n == 0) {
 -                                    tmp2 = tmp;
 -                                } else {
 -                                    tcg_gen_shli_i32(tmp, tmp, n * 8);
 -                                    tcg_gen_or_i32(tmp2, tmp2, tmp);
 -                                    tcg_temp_free_i32(tmp);
 -                                }
 -                            }
 -                            neon_store_reg(rd, pass, tmp2);
 -                        } else {
 -                            tmp2 = neon_load_reg(rd, pass);
 -                            for (n = 0; n < 4; n++) {
 -                                tmp = tcg_temp_new_i32();
 -                                if (n == 0) {
 -                                    tcg_gen_mov_i32(tmp, tmp2);
 -                                } else {
 -                                    tcg_gen_shri_i32(tmp, tmp2, n * 8);
 -                                }
 -                                gen_aa32_st8(s, tmp, addr, get_mem_index(s));
 -                                tcg_temp_free_i32(tmp);
 -                                tcg_gen_addi_i32(addr, addr, stride);
 -                            }
 -                            tcg_temp_free_i32(tmp2);
 -                        }
 +            for (n = 0; n < 8 >> size; n++) {
 +                int xs;
 +                for (xs = 0; xs < interleave; xs++) {
 +                    int tt = rd + reg + spacing * xs;
 +
 +                    if (load) {
 +                        gen_aa32_ld_i64(s, tmp64, addr, mmu_idx, endian | size);
 +                        neon_store_element64(tt, n, size, tmp64);
 +                    } else {
 +                        neon_load_element64(tmp64, tt, n, size);
 +                        gen_aa32_st_i64(s, tmp64, addr, mmu_idx, endian | size);
                      }
 +                    tcg_gen_add_i32(addr, addr, tmp2);
                  }
              }
 -            rd += spacing;
          }
          tcg_temp_free_i32(addr);
 -        stride = nregs * 8;
 +        tcg_temp_free_i32(tmp2);
 +        tcg_temp_free_i64(tmp64);
 +        stride = nregs * interleave * 8;
      } else {
          size = (insn >> 10) & 3;
          if (size == 3) {
 --
-.19.1
+.25.1

-New patch
+[PULL 017/117] target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zzxz
+From: Richard Henderson <richard.henderson@linaro.org>
+Convert SVE translation functions directly using
+gen_gvec_ool_arg_zzxz to TRANS_FEAT.  Also include
+BFDOT_zzxz, which was using gen_gvec_ool_zzzz.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-15-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 48 +++++++++++---------------------------
+file changed, 14 insertions(+), 34 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(DOT_zzzz, aa64_sve, gen_gvec_ool_zzzz,
+  * SVE Multiply - Indexed
+  */
+-#define DO_RRXR(NAME, FUNC) \
+-    static bool NAME(DisasContext *s, arg_rrxr_esz *a)  \
+-    { return gen_gvec_ool_arg_zzxz(s, FUNC, a); }
++TRANS_FEAT(SDOT_zzxw_s, aa64_sve, gen_gvec_ool_arg_zzxz,
++           gen_helper_gvec_sdot_idx_b, a)
++TRANS_FEAT(SDOT_zzxw_d, aa64_sve, gen_gvec_ool_arg_zzxz,
++           gen_helper_gvec_sdot_idx_h, a)
++TRANS_FEAT(UDOT_zzxw_s, aa64_sve, gen_gvec_ool_arg_zzxz,
++           gen_helper_gvec_udot_idx_b, a)
++TRANS_FEAT(UDOT_zzxw_d, aa64_sve, gen_gvec_ool_arg_zzxz,
++           gen_helper_gvec_udot_idx_h, a)
+-DO_RRXR(trans_SDOT_zzxw_s, gen_helper_gvec_sdot_idx_b)
+-DO_RRXR(trans_SDOT_zzxw_d, gen_helper_gvec_sdot_idx_h)
+-DO_RRXR(trans_UDOT_zzxw_s, gen_helper_gvec_udot_idx_b)
+-DO_RRXR(trans_UDOT_zzxw_d, gen_helper_gvec_udot_idx_h)
+-
+-static bool trans_SUDOT_zzxw_s(DisasContext *s, arg_rrxr_esz *a)
+-{
+-    if (!dc_isar_feature(aa64_sve_i8mm, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_arg_zzxz(s, gen_helper_gvec_sudot_idx_b, a);
+-}
+-
+-static bool trans_USDOT_zzxw_s(DisasContext *s, arg_rrxr_esz *a)
+-{
+-    if (!dc_isar_feature(aa64_sve_i8mm, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_arg_zzxz(s, gen_helper_gvec_usdot_idx_b, a);
+-}
+-
+-#undef DO_RRXR
++TRANS_FEAT(SUDOT_zzxw_s, aa64_sve_i8mm, gen_gvec_ool_arg_zzxz,
++           gen_helper_gvec_sudot_idx_b, a)
++TRANS_FEAT(USDOT_zzxw_s, aa64_sve_i8mm, gen_gvec_ool_arg_zzxz,
++           gen_helper_gvec_usdot_idx_b, a)
+ static bool do_sve2_zzz_data(DisasContext *s, int rd, int rn, int rm, int data,
+                              gen_helper_gvec_3 *fn)
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(UMMLA, aa64_sve_i8mm, gen_gvec_ool_arg_zzzz,
+ TRANS_FEAT(BFDOT_zzzz, aa64_sve_bf16, gen_gvec_ool_arg_zzzz,
+            gen_helper_gvec_bfdot, a, 0)
+-
+-static bool trans_BFDOT_zzxz(DisasContext *s, arg_rrxr_esz *a)
+-{
+-    if (!dc_isar_feature(aa64_sve_bf16, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_zzzz(s, gen_helper_gvec_bfdot_idx,
+-                             a->rd, a->rn, a->rm, a->ra, a->index);
+-}
++TRANS_FEAT(BFDOT_zzxz, aa64_sve_bf16, gen_gvec_ool_arg_zzxz,
++           gen_helper_gvec_bfdot_idx, a)
+ TRANS_FEAT(BFMMLA, aa64_sve_bf16, gen_gvec_ool_arg_zzzz,
+            gen_helper_gvec_bfmmla, a, 0)
+--
+.25.1

-New patch
+[PULL 018/117] target/arm: Use TRANS_FEAT for do_sve2_zzz_data
+From: Richard Henderson <richard.henderson@linaro.org>
+Convert SVE translation functions using do_sve2_zzz_data
+to use TRANS_FEAT and gen_gvec_ool_zzz.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-16-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 69 ++++++++++++++------------------------
+file changed, 25 insertions(+), 44 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(SUDOT_zzxw_s, aa64_sve_i8mm, gen_gvec_ool_arg_zzxz,
+ TRANS_FEAT(USDOT_zzxw_s, aa64_sve_i8mm, gen_gvec_ool_arg_zzxz,
+            gen_helper_gvec_usdot_idx_b, a)
+-static bool do_sve2_zzz_data(DisasContext *s, int rd, int rn, int rm, int data,
+-                             gen_helper_gvec_3 *fn)
+-{
+-    if (fn == NULL || !dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    if (sve_access_check(s)) {
+-        unsigned vsz = vec_full_reg_size(s);
+-        tcg_gen_gvec_3_ool(vec_full_reg_offset(s, rd),
+-                           vec_full_reg_offset(s, rn),
+-                           vec_full_reg_offset(s, rm),
+-                           vsz, vsz, data, fn);
+-    }
+-    return true;
+-}
+-
+ #define DO_SVE2_RRX(NAME, FUNC) \
+-    static bool NAME(DisasContext *s, arg_rrx_esz *a)  \
+-    { return do_sve2_zzz_data(s, a->rd, a->rn, a->rm, a->index, FUNC); }
++    TRANS_FEAT(NAME, aa64_sve, gen_gvec_ool_zzz, FUNC,          \
++               a->rd, a->rn, a->rm, a->index)
+-DO_SVE2_RRX(trans_MUL_zzx_h, gen_helper_gvec_mul_idx_h)
+-DO_SVE2_RRX(trans_MUL_zzx_s, gen_helper_gvec_mul_idx_s)
+-DO_SVE2_RRX(trans_MUL_zzx_d, gen_helper_gvec_mul_idx_d)
++DO_SVE2_RRX(MUL_zzx_h, gen_helper_gvec_mul_idx_h)
++DO_SVE2_RRX(MUL_zzx_s, gen_helper_gvec_mul_idx_s)
++DO_SVE2_RRX(MUL_zzx_d, gen_helper_gvec_mul_idx_d)
+-DO_SVE2_RRX(trans_SQDMULH_zzx_h, gen_helper_sve2_sqdmulh_idx_h)
+-DO_SVE2_RRX(trans_SQDMULH_zzx_s, gen_helper_sve2_sqdmulh_idx_s)
+-DO_SVE2_RRX(trans_SQDMULH_zzx_d, gen_helper_sve2_sqdmulh_idx_d)
++DO_SVE2_RRX(SQDMULH_zzx_h, gen_helper_sve2_sqdmulh_idx_h)
++DO_SVE2_RRX(SQDMULH_zzx_s, gen_helper_sve2_sqdmulh_idx_s)
++DO_SVE2_RRX(SQDMULH_zzx_d, gen_helper_sve2_sqdmulh_idx_d)
+-DO_SVE2_RRX(trans_SQRDMULH_zzx_h, gen_helper_sve2_sqrdmulh_idx_h)
+-DO_SVE2_RRX(trans_SQRDMULH_zzx_s, gen_helper_sve2_sqrdmulh_idx_s)
+-DO_SVE2_RRX(trans_SQRDMULH_zzx_d, gen_helper_sve2_sqrdmulh_idx_d)
++DO_SVE2_RRX(SQRDMULH_zzx_h, gen_helper_sve2_sqrdmulh_idx_h)
++DO_SVE2_RRX(SQRDMULH_zzx_s, gen_helper_sve2_sqrdmulh_idx_s)
++DO_SVE2_RRX(SQRDMULH_zzx_d, gen_helper_sve2_sqrdmulh_idx_d)
+ #undef DO_SVE2_RRX
+ #define DO_SVE2_RRX_TB(NAME, FUNC, TOP) \
+-    static bool NAME(DisasContext *s, arg_rrx_esz *a)           \
+-    {                                                           \
+-        return do_sve2_zzz_data(s, a->rd, a->rn, a->rm,         \
+-                                (a->index << 1) | TOP, FUNC);   \
+-    }
++    TRANS_FEAT(NAME, aa64_sve, gen_gvec_ool_zzz, FUNC,          \
++               a->rd, a->rn, a->rm, (a->index << 1) | TOP)
+-DO_SVE2_RRX_TB(trans_SQDMULLB_zzx_s, gen_helper_sve2_sqdmull_idx_s, false)
+-DO_SVE2_RRX_TB(trans_SQDMULLB_zzx_d, gen_helper_sve2_sqdmull_idx_d, false)
+-DO_SVE2_RRX_TB(trans_SQDMULLT_zzx_s, gen_helper_sve2_sqdmull_idx_s, true)
+-DO_SVE2_RRX_TB(trans_SQDMULLT_zzx_d, gen_helper_sve2_sqdmull_idx_d, true)
++DO_SVE2_RRX_TB(SQDMULLB_zzx_s, gen_helper_sve2_sqdmull_idx_s, false)
++DO_SVE2_RRX_TB(SQDMULLB_zzx_d, gen_helper_sve2_sqdmull_idx_d, false)
++DO_SVE2_RRX_TB(SQDMULLT_zzx_s, gen_helper_sve2_sqdmull_idx_s, true)
++DO_SVE2_RRX_TB(SQDMULLT_zzx_d, gen_helper_sve2_sqdmull_idx_d, true)
+-DO_SVE2_RRX_TB(trans_SMULLB_zzx_s, gen_helper_sve2_smull_idx_s, false)
+-DO_SVE2_RRX_TB(trans_SMULLB_zzx_d, gen_helper_sve2_smull_idx_d, false)
+-DO_SVE2_RRX_TB(trans_SMULLT_zzx_s, gen_helper_sve2_smull_idx_s, true)
+-DO_SVE2_RRX_TB(trans_SMULLT_zzx_d, gen_helper_sve2_smull_idx_d, true)
++DO_SVE2_RRX_TB(SMULLB_zzx_s, gen_helper_sve2_smull_idx_s, false)
++DO_SVE2_RRX_TB(SMULLB_zzx_d, gen_helper_sve2_smull_idx_d, false)
++DO_SVE2_RRX_TB(SMULLT_zzx_s, gen_helper_sve2_smull_idx_s, true)
++DO_SVE2_RRX_TB(SMULLT_zzx_d, gen_helper_sve2_smull_idx_d, true)
+-DO_SVE2_RRX_TB(trans_UMULLB_zzx_s, gen_helper_sve2_umull_idx_s, false)
+-DO_SVE2_RRX_TB(trans_UMULLB_zzx_d, gen_helper_sve2_umull_idx_d, false)
+-DO_SVE2_RRX_TB(trans_UMULLT_zzx_s, gen_helper_sve2_umull_idx_s, true)
+-DO_SVE2_RRX_TB(trans_UMULLT_zzx_d, gen_helper_sve2_umull_idx_d, true)
++DO_SVE2_RRX_TB(UMULLB_zzx_s, gen_helper_sve2_umull_idx_s, false)
++DO_SVE2_RRX_TB(UMULLB_zzx_d, gen_helper_sve2_umull_idx_d, false)
++DO_SVE2_RRX_TB(UMULLT_zzx_s, gen_helper_sve2_umull_idx_s, true)
++DO_SVE2_RRX_TB(UMULLT_zzx_d, gen_helper_sve2_umull_idx_d, true)
+ #undef DO_SVE2_RRX_TB
+--
+.25.1

-New patch
+[PULL 019/117] target/arm: Use TRANS_FEAT for do_sve2_zzzz_data
+From: Richard Henderson <richard.henderson@linaro.org>
+Convert SVE translation functions using do_sve2_zzzz_data
+to use TRANS_FEAT and gen_gvec_ool_{zzzz,zzxz}.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-17-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 106 ++++++++++++++-----------------------
+file changed, 41 insertions(+), 65 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ DO_SVE2_RRX_TB(UMULLT_zzx_d, gen_helper_sve2_umull_idx_d, true)
+ #undef DO_SVE2_RRX_TB
+-static bool do_sve2_zzzz_data(DisasContext *s, int rd, int rn, int rm, int ra,
+-                              int data, gen_helper_gvec_4 *fn)
+-{
+-    if (fn == NULL || !dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    if (sve_access_check(s)) {
+-        unsigned vsz = vec_full_reg_size(s);
+-        tcg_gen_gvec_4_ool(vec_full_reg_offset(s, rd),
+-                           vec_full_reg_offset(s, rn),
+-                           vec_full_reg_offset(s, rm),
+-                           vec_full_reg_offset(s, ra),
+-                           vsz, vsz, data, fn);
+-    }
+-    return true;
+-}
+-
+ #define DO_SVE2_RRXR(NAME, FUNC) \
+-    static bool NAME(DisasContext *s, arg_rrxr_esz *a)  \
+-    { return do_sve2_zzzz_data(s, a->rd, a->rn, a->rm, a->ra, a->index, FUNC); }
++    TRANS_FEAT(NAME, aa64_sve2, gen_gvec_ool_arg_zzxz, FUNC, a)
+-DO_SVE2_RRXR(trans_MLA_zzxz_h, gen_helper_gvec_mla_idx_h)
+-DO_SVE2_RRXR(trans_MLA_zzxz_s, gen_helper_gvec_mla_idx_s)
+-DO_SVE2_RRXR(trans_MLA_zzxz_d, gen_helper_gvec_mla_idx_d)
++DO_SVE2_RRXR(MLA_zzxz_h, gen_helper_gvec_mla_idx_h)
++DO_SVE2_RRXR(MLA_zzxz_s, gen_helper_gvec_mla_idx_s)
++DO_SVE2_RRXR(MLA_zzxz_d, gen_helper_gvec_mla_idx_d)
+-DO_SVE2_RRXR(trans_MLS_zzxz_h, gen_helper_gvec_mls_idx_h)
+-DO_SVE2_RRXR(trans_MLS_zzxz_s, gen_helper_gvec_mls_idx_s)
+-DO_SVE2_RRXR(trans_MLS_zzxz_d, gen_helper_gvec_mls_idx_d)
++DO_SVE2_RRXR(MLS_zzxz_h, gen_helper_gvec_mls_idx_h)
++DO_SVE2_RRXR(MLS_zzxz_s, gen_helper_gvec_mls_idx_s)
++DO_SVE2_RRXR(MLS_zzxz_d, gen_helper_gvec_mls_idx_d)
+-DO_SVE2_RRXR(trans_SQRDMLAH_zzxz_h, gen_helper_sve2_sqrdmlah_idx_h)
+-DO_SVE2_RRXR(trans_SQRDMLAH_zzxz_s, gen_helper_sve2_sqrdmlah_idx_s)
+-DO_SVE2_RRXR(trans_SQRDMLAH_zzxz_d, gen_helper_sve2_sqrdmlah_idx_d)
++DO_SVE2_RRXR(SQRDMLAH_zzxz_h, gen_helper_sve2_sqrdmlah_idx_h)
++DO_SVE2_RRXR(SQRDMLAH_zzxz_s, gen_helper_sve2_sqrdmlah_idx_s)
++DO_SVE2_RRXR(SQRDMLAH_zzxz_d, gen_helper_sve2_sqrdmlah_idx_d)
+-DO_SVE2_RRXR(trans_SQRDMLSH_zzxz_h, gen_helper_sve2_sqrdmlsh_idx_h)
+-DO_SVE2_RRXR(trans_SQRDMLSH_zzxz_s, gen_helper_sve2_sqrdmlsh_idx_s)
+-DO_SVE2_RRXR(trans_SQRDMLSH_zzxz_d, gen_helper_sve2_sqrdmlsh_idx_d)
++DO_SVE2_RRXR(SQRDMLSH_zzxz_h, gen_helper_sve2_sqrdmlsh_idx_h)
++DO_SVE2_RRXR(SQRDMLSH_zzxz_s, gen_helper_sve2_sqrdmlsh_idx_s)
++DO_SVE2_RRXR(SQRDMLSH_zzxz_d, gen_helper_sve2_sqrdmlsh_idx_d)
+ #undef DO_SVE2_RRXR
+ #define DO_SVE2_RRXR_TB(NAME, FUNC, TOP) \
+-    static bool NAME(DisasContext *s, arg_rrxr_esz *a)          \
+-    {                                                           \
+-        return do_sve2_zzzz_data(s, a->rd, a->rn, a->rm, a->rd, \
+-                                 (a->index << 1) | TOP, FUNC);  \
+-    }
++    TRANS_FEAT(NAME, aa64_sve2, gen_gvec_ool_zzzz, FUNC,        \
++               a->rd, a->rn, a->rm, a->ra, (a->index << 1) | TOP)
+-DO_SVE2_RRXR_TB(trans_SQDMLALB_zzxw_s, gen_helper_sve2_sqdmlal_idx_s, false)
+-DO_SVE2_RRXR_TB(trans_SQDMLALB_zzxw_d, gen_helper_sve2_sqdmlal_idx_d, false)
+-DO_SVE2_RRXR_TB(trans_SQDMLALT_zzxw_s, gen_helper_sve2_sqdmlal_idx_s, true)
+-DO_SVE2_RRXR_TB(trans_SQDMLALT_zzxw_d, gen_helper_sve2_sqdmlal_idx_d, true)
++DO_SVE2_RRXR_TB(SQDMLALB_zzxw_s, gen_helper_sve2_sqdmlal_idx_s, false)
++DO_SVE2_RRXR_TB(SQDMLALB_zzxw_d, gen_helper_sve2_sqdmlal_idx_d, false)
++DO_SVE2_RRXR_TB(SQDMLALT_zzxw_s, gen_helper_sve2_sqdmlal_idx_s, true)
++DO_SVE2_RRXR_TB(SQDMLALT_zzxw_d, gen_helper_sve2_sqdmlal_idx_d, true)
+-DO_SVE2_RRXR_TB(trans_SQDMLSLB_zzxw_s, gen_helper_sve2_sqdmlsl_idx_s, false)
+-DO_SVE2_RRXR_TB(trans_SQDMLSLB_zzxw_d, gen_helper_sve2_sqdmlsl_idx_d, false)
+-DO_SVE2_RRXR_TB(trans_SQDMLSLT_zzxw_s, gen_helper_sve2_sqdmlsl_idx_s, true)
+-DO_SVE2_RRXR_TB(trans_SQDMLSLT_zzxw_d, gen_helper_sve2_sqdmlsl_idx_d, true)
++DO_SVE2_RRXR_TB(SQDMLSLB_zzxw_s, gen_helper_sve2_sqdmlsl_idx_s, false)
++DO_SVE2_RRXR_TB(SQDMLSLB_zzxw_d, gen_helper_sve2_sqdmlsl_idx_d, false)
++DO_SVE2_RRXR_TB(SQDMLSLT_zzxw_s, gen_helper_sve2_sqdmlsl_idx_s, true)
++DO_SVE2_RRXR_TB(SQDMLSLT_zzxw_d, gen_helper_sve2_sqdmlsl_idx_d, true)
+-DO_SVE2_RRXR_TB(trans_SMLALB_zzxw_s, gen_helper_sve2_smlal_idx_s, false)
+-DO_SVE2_RRXR_TB(trans_SMLALB_zzxw_d, gen_helper_sve2_smlal_idx_d, false)
+-DO_SVE2_RRXR_TB(trans_SMLALT_zzxw_s, gen_helper_sve2_smlal_idx_s, true)
+-DO_SVE2_RRXR_TB(trans_SMLALT_zzxw_d, gen_helper_sve2_smlal_idx_d, true)
++DO_SVE2_RRXR_TB(SMLALB_zzxw_s, gen_helper_sve2_smlal_idx_s, false)
++DO_SVE2_RRXR_TB(SMLALB_zzxw_d, gen_helper_sve2_smlal_idx_d, false)
++DO_SVE2_RRXR_TB(SMLALT_zzxw_s, gen_helper_sve2_smlal_idx_s, true)
++DO_SVE2_RRXR_TB(SMLALT_zzxw_d, gen_helper_sve2_smlal_idx_d, true)
+-DO_SVE2_RRXR_TB(trans_UMLALB_zzxw_s, gen_helper_sve2_umlal_idx_s, false)
+-DO_SVE2_RRXR_TB(trans_UMLALB_zzxw_d, gen_helper_sve2_umlal_idx_d, false)
+-DO_SVE2_RRXR_TB(trans_UMLALT_zzxw_s, gen_helper_sve2_umlal_idx_s, true)
+-DO_SVE2_RRXR_TB(trans_UMLALT_zzxw_d, gen_helper_sve2_umlal_idx_d, true)
++DO_SVE2_RRXR_TB(UMLALB_zzxw_s, gen_helper_sve2_umlal_idx_s, false)
++DO_SVE2_RRXR_TB(UMLALB_zzxw_d, gen_helper_sve2_umlal_idx_d, false)
++DO_SVE2_RRXR_TB(UMLALT_zzxw_s, gen_helper_sve2_umlal_idx_s, true)
++DO_SVE2_RRXR_TB(UMLALT_zzxw_d, gen_helper_sve2_umlal_idx_d, true)
+-DO_SVE2_RRXR_TB(trans_SMLSLB_zzxw_s, gen_helper_sve2_smlsl_idx_s, false)
+-DO_SVE2_RRXR_TB(trans_SMLSLB_zzxw_d, gen_helper_sve2_smlsl_idx_d, false)
+-DO_SVE2_RRXR_TB(trans_SMLSLT_zzxw_s, gen_helper_sve2_smlsl_idx_s, true)
+-DO_SVE2_RRXR_TB(trans_SMLSLT_zzxw_d, gen_helper_sve2_smlsl_idx_d, true)
++DO_SVE2_RRXR_TB(SMLSLB_zzxw_s, gen_helper_sve2_smlsl_idx_s, false)
++DO_SVE2_RRXR_TB(SMLSLB_zzxw_d, gen_helper_sve2_smlsl_idx_d, false)
++DO_SVE2_RRXR_TB(SMLSLT_zzxw_s, gen_helper_sve2_smlsl_idx_s, true)
++DO_SVE2_RRXR_TB(SMLSLT_zzxw_d, gen_helper_sve2_smlsl_idx_d, true)
+-DO_SVE2_RRXR_TB(trans_UMLSLB_zzxw_s, gen_helper_sve2_umlsl_idx_s, false)
+-DO_SVE2_RRXR_TB(trans_UMLSLB_zzxw_d, gen_helper_sve2_umlsl_idx_d, false)
+-DO_SVE2_RRXR_TB(trans_UMLSLT_zzxw_s, gen_helper_sve2_umlsl_idx_s, true)
+-DO_SVE2_RRXR_TB(trans_UMLSLT_zzxw_d, gen_helper_sve2_umlsl_idx_d, true)
++DO_SVE2_RRXR_TB(UMLSLB_zzxw_s, gen_helper_sve2_umlsl_idx_s, false)
++DO_SVE2_RRXR_TB(UMLSLB_zzxw_d, gen_helper_sve2_umlsl_idx_d, false)
++DO_SVE2_RRXR_TB(UMLSLT_zzxw_s, gen_helper_sve2_umlsl_idx_s, true)
++DO_SVE2_RRXR_TB(UMLSLT_zzxw_d, gen_helper_sve2_umlsl_idx_d, true)
+ #undef DO_SVE2_RRXR_TB
+ #define DO_SVE2_RRXR_ROT(NAME, FUNC) \
+-    static bool trans_##NAME(DisasContext *s, arg_##NAME *a)       \
+-    {                                                              \
+-        return do_sve2_zzzz_data(s, a->rd, a->rn, a->rm, a->ra,    \
+-                                 (a->index << 2) | a->rot, FUNC);  \
+-    }
++    TRANS_FEAT(NAME, aa64_sve2, gen_gvec_ool_zzzz, FUNC,           \
++               a->rd, a->rn, a->rm, a->ra, (a->index << 2) | a->rot)
+ DO_SVE2_RRXR_ROT(CMLA_zzxz_h, gen_helper_sve2_cmla_idx_h)
+ DO_SVE2_RRXR_ROT(CMLA_zzxz_s, gen_helper_sve2_cmla_idx_s)
+--
+.25.1

-New patch
+[PULL 020/117] target/arm: Use TRANS_FEAT for do_sve2_zzw_data
+From: Richard Henderson <richard.henderson@linaro.org>
+Convert SVE translation functions using do_sve2_zzw_data
+to use TRANS_FEAT and gen_gvec_ool_arg_zzz.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-18-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 297 ++++++++++++++++++-------------------
+file changed, 145 insertions(+), 152 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ DO_SVE2_ZPZZ(USQADD, usqadd)
+  * SVE2 Widening Integer Arithmetic
+  */
+-static bool do_sve2_zzw_ool(DisasContext *s, arg_rrr_esz *a,
+-                            gen_helper_gvec_3 *fn, int data)
+-{
+-    if (fn == NULL || !dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    if (sve_access_check(s)) {
+-        unsigned vsz = vec_full_reg_size(s);
+-        tcg_gen_gvec_3_ool(vec_full_reg_offset(s, a->rd),
+-                           vec_full_reg_offset(s, a->rn),
+-                           vec_full_reg_offset(s, a->rm),
+-                           vsz, vsz, data, fn);
+-    }
+-    return true;
+-}
++static gen_helper_gvec_3 * const saddl_fns[4] = {
++    NULL,                    gen_helper_sve2_saddl_h,
++    gen_helper_sve2_saddl_s, gen_helper_sve2_saddl_d,
++};
++TRANS_FEAT(SADDLB, aa64_sve2, gen_gvec_ool_arg_zzz,
++           saddl_fns[a->esz], a, 0)
++TRANS_FEAT(SADDLT, aa64_sve2, gen_gvec_ool_arg_zzz,
++           saddl_fns[a->esz], a, 3)
++TRANS_FEAT(SADDLBT, aa64_sve2, gen_gvec_ool_arg_zzz,
++           saddl_fns[a->esz], a, 2)
+-#define DO_SVE2_ZZZ_TB(NAME, name, SEL1, SEL2) \
+-static bool trans_##NAME(DisasContext *s, arg_rrr_esz *a)               \
+-{                                                                       \
+-    static gen_helper_gvec_3 * const fns[4] = {                         \
+-        NULL,                       gen_helper_sve2_##name##_h,         \
+-        gen_helper_sve2_##name##_s, gen_helper_sve2_##name##_d,         \
+-    };                                                                  \
+-    return do_sve2_zzw_ool(s, a, fns[a->esz], (SEL2 << 1) | SEL1);      \
+-}
++static gen_helper_gvec_3 * const ssubl_fns[4] = {
++    NULL,                    gen_helper_sve2_ssubl_h,
++    gen_helper_sve2_ssubl_s, gen_helper_sve2_ssubl_d,
++};
++TRANS_FEAT(SSUBLB, aa64_sve2, gen_gvec_ool_arg_zzz,
++           ssubl_fns[a->esz], a, 0)
++TRANS_FEAT(SSUBLT, aa64_sve2, gen_gvec_ool_arg_zzz,
++           ssubl_fns[a->esz], a, 3)
++TRANS_FEAT(SSUBLBT, aa64_sve2, gen_gvec_ool_arg_zzz,
++           ssubl_fns[a->esz], a, 2)
++TRANS_FEAT(SSUBLTB, aa64_sve2, gen_gvec_ool_arg_zzz,
++           ssubl_fns[a->esz], a, 1)
+-DO_SVE2_ZZZ_TB(SADDLB, saddl, false, false)
+-DO_SVE2_ZZZ_TB(SSUBLB, ssubl, false, false)
+-DO_SVE2_ZZZ_TB(SABDLB, sabdl, false, false)
++static gen_helper_gvec_3 * const sabdl_fns[4] = {
++    NULL,                    gen_helper_sve2_sabdl_h,
++    gen_helper_sve2_sabdl_s, gen_helper_sve2_sabdl_d,
++};
++TRANS_FEAT(SABDLB, aa64_sve2, gen_gvec_ool_arg_zzz,
++           sabdl_fns[a->esz], a, 0)
++TRANS_FEAT(SABDLT, aa64_sve2, gen_gvec_ool_arg_zzz,
++           sabdl_fns[a->esz], a, 3)
+-DO_SVE2_ZZZ_TB(UADDLB, uaddl, false, false)
+-DO_SVE2_ZZZ_TB(USUBLB, usubl, false, false)
+-DO_SVE2_ZZZ_TB(UABDLB, uabdl, false, false)
++static gen_helper_gvec_3 * const uaddl_fns[4] = {
++    NULL,                    gen_helper_sve2_uaddl_h,
++    gen_helper_sve2_uaddl_s, gen_helper_sve2_uaddl_d,
++};
++TRANS_FEAT(UADDLB, aa64_sve2, gen_gvec_ool_arg_zzz,
++           uaddl_fns[a->esz], a, 0)
++TRANS_FEAT(UADDLT, aa64_sve2, gen_gvec_ool_arg_zzz,
++           uaddl_fns[a->esz], a, 3)
+-DO_SVE2_ZZZ_TB(SADDLT, saddl, true, true)
+-DO_SVE2_ZZZ_TB(SSUBLT, ssubl, true, true)
+-DO_SVE2_ZZZ_TB(SABDLT, sabdl, true, true)
++static gen_helper_gvec_3 * const usubl_fns[4] = {
++    NULL,                    gen_helper_sve2_usubl_h,
++    gen_helper_sve2_usubl_s, gen_helper_sve2_usubl_d,
++};
++TRANS_FEAT(USUBLB, aa64_sve2, gen_gvec_ool_arg_zzz,
++           usubl_fns[a->esz], a, 0)
++TRANS_FEAT(USUBLT, aa64_sve2, gen_gvec_ool_arg_zzz,
++           usubl_fns[a->esz], a, 3)
+-DO_SVE2_ZZZ_TB(UADDLT, uaddl, true, true)
+-DO_SVE2_ZZZ_TB(USUBLT, usubl, true, true)
+-DO_SVE2_ZZZ_TB(UABDLT, uabdl, true, true)
++static gen_helper_gvec_3 * const uabdl_fns[4] = {
++    NULL,                    gen_helper_sve2_uabdl_h,
++    gen_helper_sve2_uabdl_s, gen_helper_sve2_uabdl_d,
++};
++TRANS_FEAT(UABDLB, aa64_sve2, gen_gvec_ool_arg_zzz,
++           uabdl_fns[a->esz], a, 0)
++TRANS_FEAT(UABDLT, aa64_sve2, gen_gvec_ool_arg_zzz,
++           uabdl_fns[a->esz], a, 3)
+-DO_SVE2_ZZZ_TB(SADDLBT, saddl, false, true)
+-DO_SVE2_ZZZ_TB(SSUBLBT, ssubl, false, true)
+-DO_SVE2_ZZZ_TB(SSUBLTB, ssubl, true, false)
++static gen_helper_gvec_3 * const sqdmull_fns[4] = {
++    NULL,                          gen_helper_sve2_sqdmull_zzz_h,
++    gen_helper_sve2_sqdmull_zzz_s, gen_helper_sve2_sqdmull_zzz_d,
++};
++TRANS_FEAT(SQDMULLB_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
++           sqdmull_fns[a->esz], a, 0)
++TRANS_FEAT(SQDMULLT_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
++           sqdmull_fns[a->esz], a, 3)
+-DO_SVE2_ZZZ_TB(SQDMULLB_zzz, sqdmull_zzz, false, false)
+-DO_SVE2_ZZZ_TB(SQDMULLT_zzz, sqdmull_zzz, true, true)
++static gen_helper_gvec_3 * const smull_fns[4] = {
++    NULL,                        gen_helper_sve2_smull_zzz_h,
++    gen_helper_sve2_smull_zzz_s, gen_helper_sve2_smull_zzz_d,
++};
++TRANS_FEAT(SMULLB_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
++           smull_fns[a->esz], a, 0)
++TRANS_FEAT(SMULLT_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
++           smull_fns[a->esz], a, 3)
+-DO_SVE2_ZZZ_TB(SMULLB_zzz, smull_zzz, false, false)
+-DO_SVE2_ZZZ_TB(SMULLT_zzz, smull_zzz, true, true)
++static gen_helper_gvec_3 * const umull_fns[4] = {
++    NULL,                        gen_helper_sve2_umull_zzz_h,
++    gen_helper_sve2_umull_zzz_s, gen_helper_sve2_umull_zzz_d,
++};
++TRANS_FEAT(UMULLB_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
++           umull_fns[a->esz], a, 0)
++TRANS_FEAT(UMULLT_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
++           umull_fns[a->esz], a, 3)
+-DO_SVE2_ZZZ_TB(UMULLB_zzz, umull_zzz, false, false)
+-DO_SVE2_ZZZ_TB(UMULLT_zzz, umull_zzz, true, true)
+-
+-static bool do_eor_tb(DisasContext *s, arg_rrr_esz *a, bool sel1)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve2_eoril_b, gen_helper_sve2_eoril_h,
+-        gen_helper_sve2_eoril_s, gen_helper_sve2_eoril_d,
+-    };
+-    return do_sve2_zzw_ool(s, a, fns[a->esz], (!sel1 << 1) | sel1);
+-}
+-
+-static bool trans_EORBT(DisasContext *s, arg_rrr_esz *a)
+-{
+-    return do_eor_tb(s, a, false);
+-}
+-
+-static bool trans_EORTB(DisasContext *s, arg_rrr_esz *a)
+-{
+-    return do_eor_tb(s, a, true);
+-}
++static gen_helper_gvec_3 * const eoril_fns[4] = {
++    gen_helper_sve2_eoril_b, gen_helper_sve2_eoril_h,
++    gen_helper_sve2_eoril_s, gen_helper_sve2_eoril_d,
++};
++TRANS_FEAT(EORBT, aa64_sve2, gen_gvec_ool_arg_zzz, eoril_fns[a->esz], a, 2)
++TRANS_FEAT(EORTB, aa64_sve2, gen_gvec_ool_arg_zzz, eoril_fns[a->esz], a, 1)
+ static bool do_trans_pmull(DisasContext *s, arg_rrr_esz *a, bool sel)
+ {
+@@ -XXX,XX +XXX,XX @@ static bool do_trans_pmull(DisasContext *s, arg_rrr_esz *a, bool sel)
+     if (a->esz == 0 && !dc_isar_feature(aa64_sve2_pmull128, s)) {
+         return false;
+     }
+-    return do_sve2_zzw_ool(s, a, fns[a->esz], sel);
++    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, sel);
+ }
+-static bool trans_PMULLB(DisasContext *s, arg_rrr_esz *a)
+-{
+-    return do_trans_pmull(s, a, false);
+-}
++TRANS_FEAT(PMULLB, aa64_sve2, do_trans_pmull, a, false)
++TRANS_FEAT(PMULLT, aa64_sve2, do_trans_pmull, a, true)
+-static bool trans_PMULLT(DisasContext *s, arg_rrr_esz *a)
+-{
+-    return do_trans_pmull(s, a, true);
+-}
++static gen_helper_gvec_3 * const saddw_fns[4] = {
++    NULL,                    gen_helper_sve2_saddw_h,
++    gen_helper_sve2_saddw_s, gen_helper_sve2_saddw_d,
++};
++TRANS_FEAT(SADDWB, aa64_sve2, gen_gvec_ool_arg_zzz, saddw_fns[a->esz], a, 0)
++TRANS_FEAT(SADDWT, aa64_sve2, gen_gvec_ool_arg_zzz, saddw_fns[a->esz], a, 1)
+-#define DO_SVE2_ZZZ_WTB(NAME, name, SEL2) \
+-static bool trans_##NAME(DisasContext *s, arg_rrr_esz *a)       \
+-{                                                               \
+-    static gen_helper_gvec_3 * const fns[4] = {                 \
+-        NULL,                       gen_helper_sve2_##name##_h, \
+-        gen_helper_sve2_##name##_s, gen_helper_sve2_##name##_d, \
+-    };                                                          \
+-    return do_sve2_zzw_ool(s, a, fns[a->esz], SEL2);            \
+-}
++static gen_helper_gvec_3 * const ssubw_fns[4] = {
++    NULL,                    gen_helper_sve2_ssubw_h,
++    gen_helper_sve2_ssubw_s, gen_helper_sve2_ssubw_d,
++};
++TRANS_FEAT(SSUBWB, aa64_sve2, gen_gvec_ool_arg_zzz, ssubw_fns[a->esz], a, 0)
++TRANS_FEAT(SSUBWT, aa64_sve2, gen_gvec_ool_arg_zzz, ssubw_fns[a->esz], a, 1)
+-DO_SVE2_ZZZ_WTB(SADDWB, saddw, false)
+-DO_SVE2_ZZZ_WTB(SADDWT, saddw, true)
+-DO_SVE2_ZZZ_WTB(SSUBWB, ssubw, false)
+-DO_SVE2_ZZZ_WTB(SSUBWT, ssubw, true)
++static gen_helper_gvec_3 * const uaddw_fns[4] = {
++    NULL,                    gen_helper_sve2_uaddw_h,
++    gen_helper_sve2_uaddw_s, gen_helper_sve2_uaddw_d,
++};
++TRANS_FEAT(UADDWB, aa64_sve2, gen_gvec_ool_arg_zzz, uaddw_fns[a->esz], a, 0)
++TRANS_FEAT(UADDWT, aa64_sve2, gen_gvec_ool_arg_zzz, uaddw_fns[a->esz], a, 1)
+-DO_SVE2_ZZZ_WTB(UADDWB, uaddw, false)
+-DO_SVE2_ZZZ_WTB(UADDWT, uaddw, true)
+-DO_SVE2_ZZZ_WTB(USUBWB, usubw, false)
+-DO_SVE2_ZZZ_WTB(USUBWT, usubw, true)
++static gen_helper_gvec_3 * const usubw_fns[4] = {
++    NULL,                    gen_helper_sve2_usubw_h,
++    gen_helper_sve2_usubw_s, gen_helper_sve2_usubw_d,
++};
++TRANS_FEAT(USUBWB, aa64_sve2, gen_gvec_ool_arg_zzz, usubw_fns[a->esz], a, 0)
++TRANS_FEAT(USUBWT, aa64_sve2, gen_gvec_ool_arg_zzz, usubw_fns[a->esz], a, 1)
+ static void gen_sshll_vec(unsigned vece, TCGv_vec d, TCGv_vec n, int64_t imm)
+ {
+@@ -XXX,XX +XXX,XX @@ static bool trans_USHLLT(DisasContext *s, arg_rri_esz *a)
+     return do_sve2_shll_tb(s, a, true, true);
+ }
+-static bool trans_BEXT(DisasContext *s, arg_rrr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve2_bext_b, gen_helper_sve2_bext_h,
+-        gen_helper_sve2_bext_s, gen_helper_sve2_bext_d,
+-    };
+-    if (!dc_isar_feature(aa64_sve2_bitperm, s)) {
+-        return false;
+-    }
+-    return do_sve2_zzw_ool(s, a, fns[a->esz], 0);
+-}
++static gen_helper_gvec_3 * const bext_fns[4] = {
++    gen_helper_sve2_bext_b, gen_helper_sve2_bext_h,
++    gen_helper_sve2_bext_s, gen_helper_sve2_bext_d,
++};
++TRANS_FEAT(BEXT, aa64_sve2_bitperm, gen_gvec_ool_arg_zzz,
++           bext_fns[a->esz], a, 0)
+-static bool trans_BDEP(DisasContext *s, arg_rrr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve2_bdep_b, gen_helper_sve2_bdep_h,
+-        gen_helper_sve2_bdep_s, gen_helper_sve2_bdep_d,
+-    };
+-    if (!dc_isar_feature(aa64_sve2_bitperm, s)) {
+-        return false;
+-    }
+-    return do_sve2_zzw_ool(s, a, fns[a->esz], 0);
+-}
++static gen_helper_gvec_3 * const bdep_fns[4] = {
++    gen_helper_sve2_bdep_b, gen_helper_sve2_bdep_h,
++    gen_helper_sve2_bdep_s, gen_helper_sve2_bdep_d,
++};
++TRANS_FEAT(BDEP, aa64_sve2_bitperm, gen_gvec_ool_arg_zzz,
++           bdep_fns[a->esz], a, 0)
+-static bool trans_BGRP(DisasContext *s, arg_rrr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve2_bgrp_b, gen_helper_sve2_bgrp_h,
+-        gen_helper_sve2_bgrp_s, gen_helper_sve2_bgrp_d,
+-    };
+-    if (!dc_isar_feature(aa64_sve2_bitperm, s)) {
+-        return false;
+-    }
+-    return do_sve2_zzw_ool(s, a, fns[a->esz], 0);
+-}
++static gen_helper_gvec_3 * const bgrp_fns[4] = {
++    gen_helper_sve2_bgrp_b, gen_helper_sve2_bgrp_h,
++    gen_helper_sve2_bgrp_s, gen_helper_sve2_bgrp_d,
++};
++TRANS_FEAT(BGRP, aa64_sve2_bitperm, gen_gvec_ool_arg_zzz,
++           bgrp_fns[a->esz], a, 0)
+-static bool do_cadd(DisasContext *s, arg_rrr_esz *a, bool sq, bool rot)
+-{
+-    static gen_helper_gvec_3 * const fns[2][4] = {
+-        { gen_helper_sve2_cadd_b, gen_helper_sve2_cadd_h,
+-          gen_helper_sve2_cadd_s, gen_helper_sve2_cadd_d },
+-        { gen_helper_sve2_sqcadd_b, gen_helper_sve2_sqcadd_h,
+-          gen_helper_sve2_sqcadd_s, gen_helper_sve2_sqcadd_d },
+-    };
+-    return do_sve2_zzw_ool(s, a, fns[sq][a->esz], rot);
+-}
++static gen_helper_gvec_3 * const cadd_fns[4] = {
++    gen_helper_sve2_cadd_b, gen_helper_sve2_cadd_h,
++    gen_helper_sve2_cadd_s, gen_helper_sve2_cadd_d,
++};
++TRANS_FEAT(CADD_rot90, aa64_sve2, gen_gvec_ool_arg_zzz,
++           cadd_fns[a->esz], a, 0)
++TRANS_FEAT(CADD_rot270, aa64_sve2, gen_gvec_ool_arg_zzz,
++           cadd_fns[a->esz], a, 1)
+-static bool trans_CADD_rot90(DisasContext *s, arg_rrr_esz *a)
+-{
+-    return do_cadd(s, a, false, false);
+-}
+-
+-static bool trans_CADD_rot270(DisasContext *s, arg_rrr_esz *a)
+-{
+-    return do_cadd(s, a, false, true);
+-}
+-
+-static bool trans_SQCADD_rot90(DisasContext *s, arg_rrr_esz *a)
+-{
+-    return do_cadd(s, a, true, false);
+-}
+-
+-static bool trans_SQCADD_rot270(DisasContext *s, arg_rrr_esz *a)
+-{
+-    return do_cadd(s, a, true, true);
+-}
++static gen_helper_gvec_3 * const sqcadd_fns[4] = {
++    gen_helper_sve2_sqcadd_b, gen_helper_sve2_sqcadd_h,
++    gen_helper_sve2_sqcadd_s, gen_helper_sve2_sqcadd_d,
++};
++TRANS_FEAT(SQCADD_rot90, aa64_sve2, gen_gvec_ool_arg_zzz,
++           sqcadd_fns[a->esz], a, 0)
++TRANS_FEAT(SQCADD_rot270, aa64_sve2, gen_gvec_ool_arg_zzz,
++           sqcadd_fns[a->esz], a, 1)
+ static gen_helper_gvec_4 * const sabal_fns[4] = {
+     NULL,                    gen_helper_sve2_sabal_h,
+--
+.25.1

-New patch
+[PULL 021/117] target/arm: Use TRANS_FEAT for USDOT_zzzz
+From: Richard Henderson <richard.henderson@linaro.org>
+This is the last direct user of tcg_gen_gvec_4_ool.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-19-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 17 ++---------------
+file changed, 2 insertions(+), 15 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_4 * const sqrdcmlah_fns[] = {
+ TRANS_FEAT(SQRDCMLAH_zzzz, aa64_sve2, gen_gvec_ool_zzzz,
+            sqrdcmlah_fns[a->esz], a->rd, a->rn, a->rm, a->ra, a->rot)
+-static bool trans_USDOT_zzzz(DisasContext *s, arg_USDOT_zzzz *a)
+-{
+-    if (a->esz != 2 || !dc_isar_feature(aa64_sve_i8mm, s)) {
+-        return false;
+-    }
+-    if (sve_access_check(s)) {
+-        unsigned vsz = vec_full_reg_size(s);
+-        tcg_gen_gvec_4_ool(vec_full_reg_offset(s, a->rd),
+-                           vec_full_reg_offset(s, a->rn),
+-                           vec_full_reg_offset(s, a->rm),
+-                           vec_full_reg_offset(s, a->ra),
+-                           vsz, vsz, 0, gen_helper_gvec_usdot_b);
+-    }
+-    return true;
+-}
++TRANS_FEAT(USDOT_zzzz, aa64_sve_i8mm, gen_gvec_ool_arg_zzzz,
++           a->esz == 2 ? gen_helper_gvec_usdot_b : NULL, a, 0)
+ TRANS_FEAT(AESMC, aa64_sve2_aes, gen_gvec_ool_zz,
+            gen_helper_crypto_aesmc, a->rd, a->rd, a->decrypt)
+--
+.25.1

-New patch
+[PULL 022/117] target/arm: Move null function and sve check into gen_gvec_ool_zzp
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-20-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 37 +++++++++++++++----------------------
+file changed, 15 insertions(+), 22 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_arg_zzxz(DisasContext *s, gen_helper_gvec_4 *fn,
+ }
+ /* Invoke an out-of-line helper on 2 Zregs and a predicate. */
+-static void gen_gvec_ool_zzp(DisasContext *s, gen_helper_gvec_3 *fn,
++static bool gen_gvec_ool_zzp(DisasContext *s, gen_helper_gvec_3 *fn,
+                              int rd, int rn, int pg, int data)
+ {
+-    unsigned vsz = vec_full_reg_size(s);
+-    tcg_gen_gvec_3_ool(vec_full_reg_offset(s, rd),
+-                       vec_full_reg_offset(s, rn),
+-                       pred_full_reg_offset(s, pg),
+-                       vsz, vsz, data, fn);
++    if (fn == NULL) {
++        return false;
++    }
++    if (sve_access_check(s)) {
++        unsigned vsz = vec_full_reg_size(s);
++        tcg_gen_gvec_3_ool(vec_full_reg_offset(s, rd),
++                           vec_full_reg_offset(s, rn),
++                           pred_full_reg_offset(s, pg),
++                           vsz, vsz, data, fn);
++    }
++    return true;
+ }
+ /* Invoke an out-of-line helper on 3 Zregs and a predicate. */
+@@ -XXX,XX +XXX,XX @@ static bool trans_SEL_zpzz(DisasContext *s, arg_rprr_esz *a)
+ static bool do_zpz_ool(DisasContext *s, arg_rpr_esz *a, gen_helper_gvec_3 *fn)
+ {
+-    if (fn == NULL) {
+-        return false;
+-    }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzp(s, fn, a->rd, a->rn, a->pg, 0);
+-    }
+-    return true;
++    return gen_gvec_ool_zzp(s, fn, a->rd, a->rn, a->pg, 0);
+ }
+ #define DO_ZPZ(NAME, name) \
+@@ -XXX,XX +XXX,XX @@ static bool do_movz_zpz(DisasContext *s, int rd, int rn, int pg,
+         gen_helper_sve_movz_b, gen_helper_sve_movz_h,
+         gen_helper_sve_movz_s, gen_helper_sve_movz_d,
+     };
+-
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzp(s, fns[esz], rd, rn, pg, invert);
+-    }
+-    return true;
++    return gen_gvec_ool_zzp(s, fns[esz], rd, rn, pg, invert);
+ }
+ static bool do_zpzi_ool(DisasContext *s, arg_rpri_esz *a,
+                         gen_helper_gvec_3 *fn)
+ {
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzp(s, fn, a->rd, a->rn, a->pg, a->imm);
+-    }
+-    return true;
++    return gen_gvec_ool_zzp(s, fn, a->rd, a->rn, a->pg, a->imm);
+ }
+ static bool trans_ASR_zpzi(DisasContext *s, arg_rpri_esz *a)
+--
+.25.1

-[Qemu-devel] [PULL 20/45] target/arm: Report correct syndrome for FP/SIMD traps to Hyp mode
+[PULL 023/117] target/arm: Introduce gen_gvec_ool_arg_zpz
-For traps of FP/SIMD instructions to AArch32 Hyp mode, the syndrome
+From: Richard Henderson <richard.henderson@linaro.org>
 provided in HSR has more information than is reported to AArch64.
 Specifically, there are extra fields TA and coproc which indicate
 whether the trapped instruction was FP or SIMD. Add this extra
 information to the syndromes we construct, and mask it out when
 taking the exception to AArch64.
+Use gen_gvec_ool_arg_zpz instead of gen_gvec_ool_zzp
+when the arguments come from arg_rpr_esz.
+Replaces do_zpz_ool.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-21-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181012144235.19646-11-peter.maydell@linaro.org
 ---
- target/arm/internals.h | 14 +++++++++++++-
+ target/arm/translate-sve.c | 45 +++++++++++++++++++++-----------------
- target/arm/helper.c    |  9 +++++++++
+file changed, 25 insertions(+), 20 deletions(-)
  target/arm/translate.c |  8 ++++----
 files changed, 26 insertions(+), 5 deletions(-)
-diff --git a/target/arm/internals.h b/target/arm/internals.h
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/internals.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/internals.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static inline uint32_t syn_get_ec(uint32_t syn)
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_zzp(DisasContext *s, gen_helper_gvec_3 *fn,
-  * few cases the value in HSR for exceptions taken to AArch32 Hyp
+     return true;
-  * mode differs slightly, and we fix this up when populating HSR in
+ }
-  * arm_cpu_do_interrupt_aarch32_hyp().
-+ * The exception is FP/SIMD access traps -- these report extra information
++static bool gen_gvec_ool_arg_zpz(DisasContext *s, gen_helper_gvec_3 *fn,
-+ * when taking an exception to AArch32. For those we include the extra coproc
++                                 arg_rpr_esz *a, int data)
-+ * and TA fields, and mask them out when taking the exception to AArch64.
++{
-  */
++    return gen_gvec_ool_zzp(s, fn, a->rd, a->rn, a->pg, data);
  static inline uint32_t syn_uncategorized(void)
  {
@@ -XXX,XX +XXX,XX @@ static inline uint32_t syn_cp15_rrt_trap(int cv, int cond, int opc1, int crm,
  static inline uint32_t syn_fp_access_trap(int cv, int cond, bool is_16bit)
  {
 +    /* AArch32 FP trap or any AArch64 FP/SIMD trap: TA == 0 coproc == 0xa */
      return (EC_ADVSIMDFPACCESSTRAP << ARM_EL_EC_SHIFT)
          | (is_16bit ? 0 : ARM_EL_IL)
 -        | (cv << 24) | (cond << 20);
 +        | (cv << 24) | (cond << 20) | 0xa;
 +}
 +
-+static inline uint32_t syn_simd_access_trap(int cv, int cond, bool is_16bit)
++
-+{
+ /* Invoke an out-of-line helper on 3 Zregs and a predicate. */
-+    /* AArch32 SIMD trap: TA == 1 coproc == 0 */
+ static void gen_gvec_ool_zzzp(DisasContext *s, gen_helper_gvec_4 *fn,
-+    return (EC_ADVSIMDFPACCESSTRAP << ARM_EL_EC_SHIFT)
+                               int rd, int rn, int rm, int pg, int data)
-+        | (is_16bit ? 0 : ARM_EL_IL)
+@@ -XXX,XX +XXX,XX @@ static bool trans_SEL_zpzz(DisasContext *s, arg_rprr_esz *a)
-+        | (cv << 24) | (cond << 20) | (1 << 5);
+  *** SVE Integer Arithmetic - Unary Predicated Group
   */
 -static bool do_zpz_ool(DisasContext *s, arg_rpr_esz *a, gen_helper_gvec_3 *fn)
 -{
 -    return gen_gvec_ool_zzp(s, fn, a->rd, a->rn, a->pg, 0);
 -}
 -
  #define DO_ZPZ(NAME, name) \
  static bool trans_##NAME(DisasContext *s, arg_rpr_esz *a)           \
  {                                                                   \
@@ -XXX,XX +XXX,XX @@ static bool trans_##NAME(DisasContext *s, arg_rpr_esz *a)           \
          gen_helper_sve_##name##_b, gen_helper_sve_##name##_h,       \
          gen_helper_sve_##name##_s, gen_helper_sve_##name##_d,       \
      };                                                              \
 -    return do_zpz_ool(s, a, fns[a->esz]);                           \
 +    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);              \
  }
- static inline uint32_t syn_sve_access_trap(void)
+ DO_ZPZ(CLS, cls)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+@@ -XXX,XX +XXX,XX @@ static bool trans_FABS(DisasContext *s, arg_rpr_esz *a)
-index XXXXXXX..XXXXXXX 100644
+         gen_helper_sve_fabs_s,
---- a/target/arm/helper.c
+         gen_helper_sve_fabs_d
-+++ b/target/arm/helper.c
+     };
-@@ -XXX,XX +XXX,XX @@ static void arm_cpu_do_interrupt_aarch64(CPUState *cs)
+-    return do_zpz_ool(s, a, fns[a->esz]);
-     case EXCP_HVC:
++    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
-     case EXCP_HYP_TRAP:
+ }
-     case EXCP_SMC:
-+        if (syn_get_ec(env->exception.syndrome) == EC_ADVSIMDFPACCESSTRAP) {
+ static bool trans_FNEG(DisasContext *s, arg_rpr_esz *a)
-+            /*
+@@ -XXX,XX +XXX,XX @@ static bool trans_FNEG(DisasContext *s, arg_rpr_esz *a)
-+             * QEMU internal FP/SIMD syndromes from AArch32 include the
+         gen_helper_sve_fneg_s,
-+             * TA and coproc fields which are only exposed if the exception
+         gen_helper_sve_fneg_d
-+             * is taken to AArch32 Hyp mode. Mask them out to get a valid
+     };
-+             * AArch64 format syndrome.
+-    return do_zpz_ool(s, a, fns[a->esz]);
-+             */
++    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
-+            env->exception.syndrome &= ~MAKE_64BIT_MASK(0, 20);
+ }
-+        }
-         env->cp15.esr_el[new_el] = env->exception.syndrome;
+ static bool trans_SXTB(DisasContext *s, arg_rpr_esz *a)
-         break;
+@@ -XXX,XX +XXX,XX @@ static bool trans_SXTB(DisasContext *s, arg_rpr_esz *a)
-     case EXCP_IRQ:
+         gen_helper_sve_sxtb_s,
-diff --git a/target/arm/translate.c b/target/arm/translate.c
+         gen_helper_sve_sxtb_d
-index XXXXXXX..XXXXXXX 100644
+     };
---- a/target/arm/translate.c
+-    return do_zpz_ool(s, a, fns[a->esz]);
-+++ b/target/arm/translate.c
++    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
+ }
-      */
-     if (s->fp_excp_el) {
+ static bool trans_UXTB(DisasContext *s, arg_rpr_esz *a)
-         gen_exception_insn(s, 4, EXCP_UDEF,
+@@ -XXX,XX +XXX,XX @@ static bool trans_UXTB(DisasContext *s, arg_rpr_esz *a)
--                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
+         gen_helper_sve_uxtb_s,
-+                           syn_simd_access_trap(1, 0xe, false), s->fp_excp_el);
+         gen_helper_sve_uxtb_d
-         return 0;
+     };
 -    return do_zpz_ool(s, a, fns[a->esz]);
 +    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
  }
  static bool trans_SXTH(DisasContext *s, arg_rpr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_SXTH(DisasContext *s, arg_rpr_esz *a)
          gen_helper_sve_sxth_s,
          gen_helper_sve_sxth_d
      };
 -    return do_zpz_ool(s, a, fns[a->esz]);
 +    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
  }
  static bool trans_UXTH(DisasContext *s, arg_rpr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_UXTH(DisasContext *s, arg_rpr_esz *a)
          gen_helper_sve_uxth_s,
          gen_helper_sve_uxth_d
      };
 -    return do_zpz_ool(s, a, fns[a->esz]);
 +    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
  }
  static bool trans_SXTW(DisasContext *s, arg_rpr_esz *a)
  {
 -    return do_zpz_ool(s, a, a->esz == 3 ? gen_helper_sve_sxtw_d : NULL);
 +    return gen_gvec_ool_arg_zpz(s, a->esz == 3 ? gen_helper_sve_sxtw_d
 +                                : NULL, a, 0);
  }
  static bool trans_UXTW(DisasContext *s, arg_rpr_esz *a)
  {
 -    return do_zpz_ool(s, a, a->esz == 3 ? gen_helper_sve_uxtw_d : NULL);
 +    return gen_gvec_ool_arg_zpz(s, a->esz == 3 ? gen_helper_sve_uxtw_d
 +                                : NULL, a, 0);
  }
  #undef DO_ZPZ
@@ -XXX,XX +XXX,XX @@ static bool trans_COMPACT(DisasContext *s, arg_rpr_esz *a)
      static gen_helper_gvec_3 * const fns[4] = {
          NULL, NULL, gen_helper_sve_compact_s, gen_helper_sve_compact_d
      };
 -    return do_zpz_ool(s, a, fns[a->esz]);
 +    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
  }
  /* Call the helper that computes the ARM LastActiveElement pseudocode
@@ -XXX,XX +XXX,XX @@ static bool trans_REVB(DisasContext *s, arg_rpr_esz *a)
          gen_helper_sve_revb_s,
          gen_helper_sve_revb_d,
      };
 -    return do_zpz_ool(s, a, fns[a->esz]);
 +    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
  }
  static bool trans_REVH(DisasContext *s, arg_rpr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_REVH(DisasContext *s, arg_rpr_esz *a)
          gen_helper_sve_revh_s,
          gen_helper_sve_revh_d,
      };
 -    return do_zpz_ool(s, a, fns[a->esz]);
 +    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
  }
  static bool trans_REVW(DisasContext *s, arg_rpr_esz *a)
  {
 -    return do_zpz_ool(s, a, a->esz == 3 ? gen_helper_sve_revw_d : NULL);
 +    return gen_gvec_ool_arg_zpz(s, a->esz == 3 ? gen_helper_sve_revw_d
 +                                : NULL, a, 0);
  }
  static bool trans_RBIT(DisasContext *s, arg_rpr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_RBIT(DisasContext *s, arg_rpr_esz *a)
          gen_helper_sve_rbit_s,
          gen_helper_sve_rbit_d,
      };
 -    return do_zpz_ool(s, a, fns[a->esz]);
 +    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
  }
  static bool trans_SPLICE(DisasContext *s, arg_rprr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool do_sve2_zpz_ool(DisasContext *s, arg_rpr_esz *a,
      if (!dc_isar_feature(aa64_sve2, s)) {
          return false;
      }
+-    return do_zpz_ool(s, a, fn);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
++    return gen_gvec_ool_arg_zpz(s, fn, a, 0);
-      */
+ }
-     if (s->fp_excp_el) {
-         gen_exception_insn(s, 4, EXCP_UDEF,
+ static bool trans_URECPE(DisasContext *s, arg_rpr_esz *a)
 -                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
 +                           syn_simd_access_trap(1, 0xe, false), s->fp_excp_el);
          return 0;
      }
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
      if (s->fp_excp_el) {
          gen_exception_insn(s, 4, EXCP_UDEF,
 -                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
 +                           syn_simd_access_trap(1, 0xe, false), s->fp_excp_el);
          return 0;
      }
      if (!s->vfp_enabled) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
      if (s->fp_excp_el) {
          gen_exception_insn(s, 4, EXCP_UDEF,
 -                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
 +                           syn_simd_access_trap(1, 0xe, false), s->fp_excp_el);
          return 0;
      }
      if (!s->vfp_enabled) {
 --
-.19.1
+.25.1

-New patch
+[PULL 024/117] target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zpz
+From: Richard Henderson <richard.henderson@linaro.org>
+Convert SVE translation functions directly using
+gen_gvec_ool_arg_zpz to TRANS_FEAT.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-22-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 189 ++++++++++++-------------------------
+file changed, 60 insertions(+), 129 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool trans_SEL_zpzz(DisasContext *s, arg_rprr_esz *a)
+  *** SVE Integer Arithmetic - Unary Predicated Group
+  */
+-#define DO_ZPZ(NAME, name) \
+-static bool trans_##NAME(DisasContext *s, arg_rpr_esz *a)           \
+-{                                                                   \
+-    static gen_helper_gvec_3 * const fns[4] = {                     \
+-        gen_helper_sve_##name##_b, gen_helper_sve_##name##_h,       \
+-        gen_helper_sve_##name##_s, gen_helper_sve_##name##_d,       \
++#define DO_ZPZ(NAME, FEAT, name) \
++    static gen_helper_gvec_3 * const name##_fns[4] = {              \
++        gen_helper_##name##_b, gen_helper_##name##_h,               \
++        gen_helper_##name##_s, gen_helper_##name##_d,               \
+     };                                                              \
+-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);              \
+-}
++    TRANS_FEAT(NAME, FEAT, gen_gvec_ool_arg_zpz, name##_fns[a->esz], a, 0)
+-DO_ZPZ(CLS, cls)
+-DO_ZPZ(CLZ, clz)
+-DO_ZPZ(CNT_zpz, cnt_zpz)
+-DO_ZPZ(CNOT, cnot)
+-DO_ZPZ(NOT_zpz, not_zpz)
+-DO_ZPZ(ABS, abs)
+-DO_ZPZ(NEG, neg)
++DO_ZPZ(CLS, aa64_sve, sve_cls)
++DO_ZPZ(CLZ, aa64_sve, sve_clz)
++DO_ZPZ(CNT_zpz, aa64_sve, sve_cnt_zpz)
++DO_ZPZ(CNOT, aa64_sve, sve_cnot)
++DO_ZPZ(NOT_zpz, aa64_sve, sve_not_zpz)
++DO_ZPZ(ABS, aa64_sve, sve_abs)
++DO_ZPZ(NEG, aa64_sve, sve_neg)
++DO_ZPZ(RBIT, aa64_sve, sve_rbit)
+-static bool trans_FABS(DisasContext *s, arg_rpr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        NULL,
+-        gen_helper_sve_fabs_h,
+-        gen_helper_sve_fabs_s,
+-        gen_helper_sve_fabs_d
+-    };
+-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
+-}
++static gen_helper_gvec_3 * const fabs_fns[4] = {
++    NULL,                  gen_helper_sve_fabs_h,
++    gen_helper_sve_fabs_s, gen_helper_sve_fabs_d,
++};
++TRANS_FEAT(FABS, aa64_sve, gen_gvec_ool_arg_zpz, fabs_fns[a->esz], a, 0)
+-static bool trans_FNEG(DisasContext *s, arg_rpr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        NULL,
+-        gen_helper_sve_fneg_h,
+-        gen_helper_sve_fneg_s,
+-        gen_helper_sve_fneg_d
+-    };
+-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
+-}
++static gen_helper_gvec_3 * const fneg_fns[4] = {
++    NULL,                  gen_helper_sve_fneg_h,
++    gen_helper_sve_fneg_s, gen_helper_sve_fneg_d,
++};
++TRANS_FEAT(FNEG, aa64_sve, gen_gvec_ool_arg_zpz, fneg_fns[a->esz], a, 0)
+-static bool trans_SXTB(DisasContext *s, arg_rpr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        NULL,
+-        gen_helper_sve_sxtb_h,
+-        gen_helper_sve_sxtb_s,
+-        gen_helper_sve_sxtb_d
+-    };
+-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
+-}
++static gen_helper_gvec_3 * const sxtb_fns[4] = {
++    NULL,                  gen_helper_sve_sxtb_h,
++    gen_helper_sve_sxtb_s, gen_helper_sve_sxtb_d,
++};
++TRANS_FEAT(SXTB, aa64_sve, gen_gvec_ool_arg_zpz, sxtb_fns[a->esz], a, 0)
+-static bool trans_UXTB(DisasContext *s, arg_rpr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        NULL,
+-        gen_helper_sve_uxtb_h,
+-        gen_helper_sve_uxtb_s,
+-        gen_helper_sve_uxtb_d
+-    };
+-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
+-}
++static gen_helper_gvec_3 * const uxtb_fns[4] = {
++    NULL,                  gen_helper_sve_uxtb_h,
++    gen_helper_sve_uxtb_s, gen_helper_sve_uxtb_d,
++};
++TRANS_FEAT(UXTB, aa64_sve, gen_gvec_ool_arg_zpz, uxtb_fns[a->esz], a, 0)
+-static bool trans_SXTH(DisasContext *s, arg_rpr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        NULL, NULL,
+-        gen_helper_sve_sxth_s,
+-        gen_helper_sve_sxth_d
+-    };
+-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
+-}
++static gen_helper_gvec_3 * const sxth_fns[4] = {
++    NULL, NULL, gen_helper_sve_sxth_s, gen_helper_sve_sxth_d
++};
++TRANS_FEAT(SXTH, aa64_sve, gen_gvec_ool_arg_zpz, sxth_fns[a->esz], a, 0)
+-static bool trans_UXTH(DisasContext *s, arg_rpr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        NULL, NULL,
+-        gen_helper_sve_uxth_s,
+-        gen_helper_sve_uxth_d
+-    };
+-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
+-}
++static gen_helper_gvec_3 * const uxth_fns[4] = {
++    NULL, NULL, gen_helper_sve_uxth_s, gen_helper_sve_uxth_d
++};
++TRANS_FEAT(UXTH, aa64_sve, gen_gvec_ool_arg_zpz, uxth_fns[a->esz], a, 0)
+-static bool trans_SXTW(DisasContext *s, arg_rpr_esz *a)
+-{
+-    return gen_gvec_ool_arg_zpz(s, a->esz == 3 ? gen_helper_sve_sxtw_d
+-                                : NULL, a, 0);
+-}
+-
+-static bool trans_UXTW(DisasContext *s, arg_rpr_esz *a)
+-{
+-    return gen_gvec_ool_arg_zpz(s, a->esz == 3 ? gen_helper_sve_uxtw_d
+-                                : NULL, a, 0);
+-}
+-
+-#undef DO_ZPZ
++TRANS_FEAT(SXTW, aa64_sve, gen_gvec_ool_arg_zpz,
++           a->esz == 3 ? gen_helper_sve_sxtw_d : NULL, a, 0)
++TRANS_FEAT(UXTW, aa64_sve, gen_gvec_ool_arg_zpz,
++           a->esz == 3 ? gen_helper_sve_uxtw_d : NULL, a, 0)
+ /*
+  *** SVE Integer Reduction Group
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(TRN2_q, aa64_sve_f64mm, gen_gvec_ool_arg_zzz,
+  *** SVE Permute Vector - Predicated Group
+  */
+-static bool trans_COMPACT(DisasContext *s, arg_rpr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        NULL, NULL, gen_helper_sve_compact_s, gen_helper_sve_compact_d
+-    };
+-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
+-}
++static gen_helper_gvec_3 * const compact_fns[4] = {
++    NULL, NULL, gen_helper_sve_compact_s, gen_helper_sve_compact_d
++};
++TRANS_FEAT(COMPACT, aa64_sve, gen_gvec_ool_arg_zpz, compact_fns[a->esz], a, 0)
+ /* Call the helper that computes the ARM LastActiveElement pseudocode
+  * function, scaled by the element size.  This includes the not found
+@@ -XXX,XX +XXX,XX @@ static bool trans_CPY_m_v(DisasContext *s, arg_rpr_esz *a)
+     return true;
+ }
+-static bool trans_REVB(DisasContext *s, arg_rpr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        NULL,
+-        gen_helper_sve_revb_h,
+-        gen_helper_sve_revb_s,
+-        gen_helper_sve_revb_d,
+-    };
+-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
+-}
++static gen_helper_gvec_3 * const revb_fns[4] = {
++    NULL,                  gen_helper_sve_revb_h,
++    gen_helper_sve_revb_s, gen_helper_sve_revb_d,
++};
++TRANS_FEAT(REVB, aa64_sve, gen_gvec_ool_arg_zpz, revb_fns[a->esz], a, 0)
+-static bool trans_REVH(DisasContext *s, arg_rpr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        NULL,
+-        NULL,
+-        gen_helper_sve_revh_s,
+-        gen_helper_sve_revh_d,
+-    };
+-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
+-}
++static gen_helper_gvec_3 * const revh_fns[4] = {
++    NULL, NULL, gen_helper_sve_revh_s, gen_helper_sve_revh_d,
++};
++TRANS_FEAT(REVH, aa64_sve, gen_gvec_ool_arg_zpz, revh_fns[a->esz], a, 0)
+-static bool trans_REVW(DisasContext *s, arg_rpr_esz *a)
+-{
+-    return gen_gvec_ool_arg_zpz(s, a->esz == 3 ? gen_helper_sve_revw_d
+-                                : NULL, a, 0);
+-}
+-
+-static bool trans_RBIT(DisasContext *s, arg_rpr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve_rbit_b,
+-        gen_helper_sve_rbit_h,
+-        gen_helper_sve_rbit_s,
+-        gen_helper_sve_rbit_d,
+-    };
+-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
+-}
++TRANS_FEAT(REVW, aa64_sve, gen_gvec_ool_arg_zpz,
++           a->esz == 3 ? gen_helper_sve_revw_d : NULL, a, 0)
+ static bool trans_SPLICE(DisasContext *s, arg_rprr_esz *a)
+ {
+--
+.25.1

-New patch
+[PULL 025/117] target/arm: Use TRANS_FEAT for do_sve2_zpz_data
+From: Richard Henderson <richard.henderson@linaro.org>
+Convert SVE translation functions using do_sve2_zpz_data
+to use TRANS_FEAT and gen_gvec_ool_arg_zpz.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-23-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 53 ++++++++++----------------------------
+file changed, 14 insertions(+), 39 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool trans_UADALP_zpzz(DisasContext *s, arg_rprr_esz *a)
+  * SVE2 integer unary operations (predicated)
+  */
+-static bool do_sve2_zpz_ool(DisasContext *s, arg_rpr_esz *a,
+-                            gen_helper_gvec_3 *fn)
+-{
+-    if (!dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_arg_zpz(s, fn, a, 0);
+-}
++TRANS_FEAT(URECPE, aa64_sve2, gen_gvec_ool_arg_zpz,
++           a->esz == 2 ? gen_helper_sve2_urecpe_s : NULL, a, 0)
+-static bool trans_URECPE(DisasContext *s, arg_rpr_esz *a)
+-{
+-    if (a->esz != 2) {
+-        return false;
+-    }
+-    return do_sve2_zpz_ool(s, a, gen_helper_sve2_urecpe_s);
+-}
++TRANS_FEAT(URSQRTE, aa64_sve2, gen_gvec_ool_arg_zpz,
++           a->esz == 2 ? gen_helper_sve2_ursqrte_s : NULL, a, 0)
+-static bool trans_URSQRTE(DisasContext *s, arg_rpr_esz *a)
+-{
+-    if (a->esz != 2) {
+-        return false;
+-    }
+-    return do_sve2_zpz_ool(s, a, gen_helper_sve2_ursqrte_s);
+-}
++static gen_helper_gvec_3 * const sqabs_fns[4] = {
++    gen_helper_sve2_sqabs_b, gen_helper_sve2_sqabs_h,
++    gen_helper_sve2_sqabs_s, gen_helper_sve2_sqabs_d,
++};
++TRANS_FEAT(SQABS, aa64_sve2, gen_gvec_ool_arg_zpz, sqabs_fns[a->esz], a, 0)
+-static bool trans_SQABS(DisasContext *s, arg_rpr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve2_sqabs_b, gen_helper_sve2_sqabs_h,
+-        gen_helper_sve2_sqabs_s, gen_helper_sve2_sqabs_d,
+-    };
+-    return do_sve2_zpz_ool(s, a, fns[a->esz]);
+-}
+-
+-static bool trans_SQNEG(DisasContext *s, arg_rpr_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve2_sqneg_b, gen_helper_sve2_sqneg_h,
+-        gen_helper_sve2_sqneg_s, gen_helper_sve2_sqneg_d,
+-    };
+-    return do_sve2_zpz_ool(s, a, fns[a->esz]);
+-}
++static gen_helper_gvec_3 * const sqneg_fns[4] = {
++    gen_helper_sve2_sqneg_b, gen_helper_sve2_sqneg_h,
++    gen_helper_sve2_sqneg_s, gen_helper_sve2_sqneg_d,
++};
++TRANS_FEAT(SQNEG, aa64_sve2, gen_gvec_ool_arg_zpz, sqneg_fns[a->esz], a, 0)
+ #define DO_SVE2_ZPZZ(NAME, name) \
+ static bool trans_##NAME(DisasContext *s, arg_rprr_esz *a)                \
+--
+.25.1

-[Qemu-devel] [PULL 11/45] target/arm: Improve debug logging of AArch32 exception return
+[PULL 026/117] target/arm: Rename do_zpzi_ool to gen_gvec_ool_arg_zpzi
-For AArch32, exception return happens through certain kinds
+From: Richard Henderson <richard.henderson@linaro.org>
 of CPSR write. We don't currently have any CPU_LOG_INT logging
 of these events (unlike AArch64, where we log in the ERET
 instruction). Add some suitable logging.
-This will log exception returns like this:
+Rename the function to match gen_gvec_ool_arg_zpz,
-Exception return from AArch32 hyp to usr PC 0x80100374
+and move to be adjacent.
-paralleling the existing logging in the exception_return
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-helper for AArch64 exception returns:
+Message-id: 20220527181907.189259-24-richard.henderson@linaro.org
-Exception return from AArch64 EL2 to AArch64 EL0 PC 0x8003045c
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Exception return from AArch64 EL2 to AArch32 EL0 PC 0x8003045c
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/translate-sve.c | 29 ++++++++++++++---------------
 file changed, 14 insertions(+), 15 deletions(-)
-(Note that an AArch32 exception return can only be
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 AArch32->AArch32, never to AArch64.)
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20181012144235.19646-2-peter.maydell@linaro.org
 ---
  target/arm/internals.h | 18 ++++++++++++++++++
  target/arm/helper.c    | 10 ++++++++++
  target/arm/translate.c |  7 +------
 files changed, 29 insertions(+), 6 deletions(-)
 diff --git a/target/arm/internals.h b/target/arm/internals.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/internals.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/internals.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static inline uint32_t v7m_sp_limit(CPUARMState *env)
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_arg_zpz(DisasContext *s, gen_helper_gvec_3 *fn,
      return gen_gvec_ool_zzp(s, fn, a->rd, a->rn, a->pg, data);
  }
 +static bool gen_gvec_ool_arg_zpzi(DisasContext *s, gen_helper_gvec_3 *fn,
 +                                  arg_rpri_esz *a)
 +{
 +    return gen_gvec_ool_zzp(s, fn, a->rd, a->rn, a->pg, a->imm);
 +}
  /* Invoke an out-of-line helper on 3 Zregs and a predicate. */
  static void gen_gvec_ool_zzzp(DisasContext *s, gen_helper_gvec_4 *fn,
@@ -XXX,XX +XXX,XX @@ static bool do_movz_zpz(DisasContext *s, int rd, int rn, int pg,
      return gen_gvec_ool_zzp(s, fns[esz], rd, rn, pg, invert);
  }
 -static bool do_zpzi_ool(DisasContext *s, arg_rpri_esz *a,
 -                        gen_helper_gvec_3 *fn)
 -{
 -    return gen_gvec_ool_zzp(s, fn, a->rd, a->rn, a->pg, a->imm);
 -}
 -
  static bool trans_ASR_zpzi(DisasContext *s, arg_rpri_esz *a)
  {
      static gen_helper_gvec_3 * const fns[4] = {
@@ -XXX,XX +XXX,XX @@ static bool trans_ASR_zpzi(DisasContext *s, arg_rpri_esz *a)
      /* Shift by element size is architecturally valid.  For
         arithmetic right-shift, it's the same as by one less. */
      a->imm = MIN(a->imm, (8 << a->esz) - 1);
 -    return do_zpzi_ool(s, a, fns[a->esz]);
 +    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
  }
  static bool trans_LSR_zpzi(DisasContext *s, arg_rpri_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_LSR_zpzi(DisasContext *s, arg_rpri_esz *a)
      if (a->imm >= (8 << a->esz)) {
          return do_movz_zpz(s, a->rd, a->rd, a->pg, a->esz, true);
      } else {
 -        return do_zpzi_ool(s, a, fns[a->esz]);
 +        return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
      }
  }
-+/**
+@@ -XXX,XX +XXX,XX @@ static bool trans_LSL_zpzi(DisasContext *s, arg_rpri_esz *a)
-+ * aarch32_mode_name(): Return name of the AArch32 CPU mode
+     if (a->imm >= (8 << a->esz)) {
-+ * @psr: Program Status Register indicating CPU mode
+         return do_movz_zpz(s, a->rd, a->rd, a->pg, a->esz, true);
-+ *
+     } else {
-+ * Returns, for debug logging purposes, a printable representation
+-        return do_zpzi_ool(s, a, fns[a->esz]);
-+ * of the AArch32 CPU mode ("svc", "usr", etc) as indicated by
++        return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
 + * the low bits of the specified PSR.
 + */
 +static inline const char *aarch32_mode_name(uint32_t psr)
 +{
 +    static const char cpu_mode_names[16][4] = {
 +        "usr", "fiq", "irq", "svc", "???", "???", "mon", "abt",
 +        "???", "???", "hyp", "und", "???", "???", "???", "sys"
 +    };
 +
 +    return cpu_mode_names[psr & 0xf];
 +}
 +
  #endif
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void cpsr_write(CPUARMState *env, uint32_t val, uint32_t mask,
                  mask |= CPSR_IL;
                  val |= CPSR_IL;
              }
 +            qemu_log_mask(LOG_GUEST_ERROR,
 +                          "Illegal AArch32 mode switch attempt from %s to %s\n",
 +                          aarch32_mode_name(env->uncached_cpsr),
 +                          aarch32_mode_name(val));
          } else {
 +            qemu_log_mask(CPU_LOG_INT, "%s %s to %s PC 0x%" PRIx32 "\n",
 +                          write_type == CPSRWriteExceptionReturn ?
 +                          "Exception return from AArch32" :
 +                          "AArch32 mode switch from",
 +                          aarch32_mode_name(env->uncached_cpsr),
 +                          aarch32_mode_name(val), env->regs[15]);
              switch_mode(env, val & CPSR_M);
          }
      }
-diff --git a/target/arm/translate.c b/target/arm/translate.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
-+++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ void gen_intermediate_code(CPUState *cpu, TranslationBlock *tb)
-     translator_loop(ops, &dc.base, cpu, tb);
  }
--static const char *cpu_mode_names[16] = {
+@@ -XXX,XX +XXX,XX @@ static bool trans_ASRD(DisasContext *s, arg_rpri_esz *a)
--  "usr", "fiq", "irq", "svc", "???", "???", "mon", "abt",
+     if (a->imm >= (8 << a->esz)) {
--  "???", "???", "hyp", "und", "???", "???", "???", "sys"
+         return do_movz_zpz(s, a->rd, a->rd, a->pg, a->esz, true);
--};
+     } else {
--
+-        return do_zpzi_ool(s, a, fns[a->esz]);
- void arm_cpu_dump_state(CPUState *cs, FILE *f, fprintf_function cpu_fprintf,
++        return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
                          int flags)
  {
@@ -XXX,XX +XXX,XX @@ void arm_cpu_dump_state(CPUState *cs, FILE *f, fprintf_function cpu_fprintf,
                      psr & CPSR_V ? 'V' : '-',
                      psr & CPSR_T ? 'T' : 'A',
                      ns_status,
 -                    cpu_mode_names[psr & 0xf], (psr & 0x10) ? 32 : 26);
 +                    aarch32_mode_name(psr), (psr & 0x10) ? 32 : 26);
      }
+ }
-     if (flags & CPU_DUMP_FPU) {
@@ -XXX,XX +XXX,XX @@ static bool trans_SQSHL_zpzi(DisasContext *s, arg_rpri_esz *a)
      if (a->esz < 0 || !dc_isar_feature(aa64_sve2, s)) {
          return false;
      }
 -    return do_zpzi_ool(s, a, fns[a->esz]);
 +    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
  }
  static bool trans_UQSHL_zpzi(DisasContext *s, arg_rpri_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_UQSHL_zpzi(DisasContext *s, arg_rpri_esz *a)
      if (a->esz < 0 || !dc_isar_feature(aa64_sve2, s)) {
          return false;
      }
 -    return do_zpzi_ool(s, a, fns[a->esz]);
 +    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
  }
  static bool trans_SRSHR(DisasContext *s, arg_rpri_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_SRSHR(DisasContext *s, arg_rpri_esz *a)
      if (a->esz < 0 || !dc_isar_feature(aa64_sve2, s)) {
          return false;
      }
 -    return do_zpzi_ool(s, a, fns[a->esz]);
 +    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
  }
  static bool trans_URSHR(DisasContext *s, arg_rpri_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_URSHR(DisasContext *s, arg_rpri_esz *a)
      if (a->esz < 0 || !dc_isar_feature(aa64_sve2, s)) {
          return false;
      }
 -    return do_zpzi_ool(s, a, fns[a->esz]);
 +    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
  }
  static bool trans_SQSHLU(DisasContext *s, arg_rpri_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_SQSHLU(DisasContext *s, arg_rpri_esz *a)
      if (a->esz < 0 || !dc_isar_feature(aa64_sve2, s)) {
          return false;
      }
 -    return do_zpzi_ool(s, a, fns[a->esz]);
 +    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
  }
  /*
 --
-.19.1
+.25.1

-New patch
+[PULL 027/117] target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zpzi
+From: Richard Henderson <richard.henderson@linaro.org>
+Convert some SVE translation functions using
+gen_gvec_ool_arg_zpzi to TRANS_FEAT.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-25-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 85 ++++++++++++++------------------------
+file changed, 30 insertions(+), 55 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool trans_ASRD(DisasContext *s, arg_rpri_esz *a)
+     }
+ }
+-static bool trans_SQSHL_zpzi(DisasContext *s, arg_rpri_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve2_sqshl_zpzi_b, gen_helper_sve2_sqshl_zpzi_h,
+-        gen_helper_sve2_sqshl_zpzi_s, gen_helper_sve2_sqshl_zpzi_d,
+-    };
+-    if (a->esz < 0 || !dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
+-}
++static gen_helper_gvec_3 * const sqshl_zpzi_fns[4] = {
++    gen_helper_sve2_sqshl_zpzi_b, gen_helper_sve2_sqshl_zpzi_h,
++    gen_helper_sve2_sqshl_zpzi_s, gen_helper_sve2_sqshl_zpzi_d,
++};
++TRANS_FEAT(SQSHL_zpzi, aa64_sve2, gen_gvec_ool_arg_zpzi,
++           a->esz < 0 ? NULL : sqshl_zpzi_fns[a->esz], a)
+-static bool trans_UQSHL_zpzi(DisasContext *s, arg_rpri_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve2_uqshl_zpzi_b, gen_helper_sve2_uqshl_zpzi_h,
+-        gen_helper_sve2_uqshl_zpzi_s, gen_helper_sve2_uqshl_zpzi_d,
+-    };
+-    if (a->esz < 0 || !dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
+-}
++static gen_helper_gvec_3 * const uqshl_zpzi_fns[4] = {
++    gen_helper_sve2_uqshl_zpzi_b, gen_helper_sve2_uqshl_zpzi_h,
++    gen_helper_sve2_uqshl_zpzi_s, gen_helper_sve2_uqshl_zpzi_d,
++};
++TRANS_FEAT(UQSHL_zpzi, aa64_sve2, gen_gvec_ool_arg_zpzi,
++           a->esz < 0 ? NULL : uqshl_zpzi_fns[a->esz], a)
+-static bool trans_SRSHR(DisasContext *s, arg_rpri_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve2_srshr_b, gen_helper_sve2_srshr_h,
+-        gen_helper_sve2_srshr_s, gen_helper_sve2_srshr_d,
+-    };
+-    if (a->esz < 0 || !dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
+-}
++static gen_helper_gvec_3 * const srshr_fns[4] = {
++    gen_helper_sve2_srshr_b, gen_helper_sve2_srshr_h,
++    gen_helper_sve2_srshr_s, gen_helper_sve2_srshr_d,
++};
++TRANS_FEAT(SRSHR, aa64_sve2, gen_gvec_ool_arg_zpzi,
++           a->esz < 0 ? NULL : srshr_fns[a->esz], a)
+-static bool trans_URSHR(DisasContext *s, arg_rpri_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve2_urshr_b, gen_helper_sve2_urshr_h,
+-        gen_helper_sve2_urshr_s, gen_helper_sve2_urshr_d,
+-    };
+-    if (a->esz < 0 || !dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
+-}
++static gen_helper_gvec_3 * const urshr_fns[4] = {
++    gen_helper_sve2_urshr_b, gen_helper_sve2_urshr_h,
++    gen_helper_sve2_urshr_s, gen_helper_sve2_urshr_d,
++};
++TRANS_FEAT(URSHR, aa64_sve2, gen_gvec_ool_arg_zpzi,
++           a->esz < 0 ? NULL : urshr_fns[a->esz], a)
+-static bool trans_SQSHLU(DisasContext *s, arg_rpri_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve2_sqshlu_b, gen_helper_sve2_sqshlu_h,
+-        gen_helper_sve2_sqshlu_s, gen_helper_sve2_sqshlu_d,
+-    };
+-    if (a->esz < 0 || !dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
+-}
++static gen_helper_gvec_3 * const sqshlu_fns[4] = {
++    gen_helper_sve2_sqshlu_b, gen_helper_sve2_sqshlu_h,
++    gen_helper_sve2_sqshlu_s, gen_helper_sve2_sqshlu_d,
++};
++TRANS_FEAT(SQSHLU, aa64_sve2, gen_gvec_ool_arg_zpzi,
++           a->esz < 0 ? NULL : sqshlu_fns[a->esz], a)
+ /*
+  *** SVE Bitwise Shift - Predicated Group
+--
+.25.1

-New patch
+[PULL 028/117] target/arm: Move null function and sve check into gen_gvec_ool_zzzp
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-26-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 42 ++++++++++++++++----------------------
+file changed, 18 insertions(+), 24 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_arg_zpzi(DisasContext *s, gen_helper_gvec_3 *fn,
+ }
+ /* Invoke an out-of-line helper on 3 Zregs and a predicate. */
+-static void gen_gvec_ool_zzzp(DisasContext *s, gen_helper_gvec_4 *fn,
++static bool gen_gvec_ool_zzzp(DisasContext *s, gen_helper_gvec_4 *fn,
+                               int rd, int rn, int rm, int pg, int data)
+ {
+-    unsigned vsz = vec_full_reg_size(s);
+-    tcg_gen_gvec_4_ool(vec_full_reg_offset(s, rd),
+-                       vec_full_reg_offset(s, rn),
+-                       vec_full_reg_offset(s, rm),
+-                       pred_full_reg_offset(s, pg),
+-                       vsz, vsz, data, fn);
++    if (fn == NULL) {
++        return false;
++    }
++    if (sve_access_check(s)) {
++        unsigned vsz = vec_full_reg_size(s);
++        tcg_gen_gvec_4_ool(vec_full_reg_offset(s, rd),
++                           vec_full_reg_offset(s, rn),
++                           vec_full_reg_offset(s, rm),
++                           pred_full_reg_offset(s, pg),
++                           vsz, vsz, data, fn);
++    }
++    return true;
+ }
+ /* Invoke a vector expander on two Zregs.  */
+@@ -XXX,XX +XXX,XX @@ static bool trans_UQSUB_zzz(DisasContext *s, arg_rrr_esz *a)
+ static bool do_zpzz_ool(DisasContext *s, arg_rprr_esz *a, gen_helper_gvec_4 *fn)
+ {
+-    if (fn == NULL) {
+-        return false;
+-    }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzzp(s, fn, a->rd, a->rn, a->rm, a->pg, 0);
+-    }
+-    return true;
++    return gen_gvec_ool_zzzp(s, fn, a->rd, a->rn, a->rm, a->pg, 0);
+ }
+ /* Select active elememnts from Zn and inactive elements from Zm,
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(REVW, aa64_sve, gen_gvec_ool_arg_zpz,
+ static bool trans_SPLICE(DisasContext *s, arg_rprr_esz *a)
+ {
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzzp(s, gen_helper_sve_splice,
+-                          a->rd, a->rn, a->rm, a->pg, a->esz);
+-    }
+-    return true;
++    return gen_gvec_ool_zzzp(s, gen_helper_sve_splice,
++                             a->rd, a->rn, a->rm, a->pg, a->esz);
+ }
+ static bool trans_SPLICE_sve2(DisasContext *s, arg_rpr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_SPLICE_sve2(DisasContext *s, arg_rpr_esz *a)
+     if (!dc_isar_feature(aa64_sve2, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_ool_zzzp(s, gen_helper_sve_splice,
+-                          a->rd, a->rn, (a->rn + 1) % 32, a->pg, a->esz);
+-    }
+-    return true;
++    return gen_gvec_ool_zzzp(s, gen_helper_sve_splice,
++                             a->rd, a->rn, (a->rn + 1) % 32, a->pg, a->esz);
+ }
+ /*
+--
+.25.1

-[Qemu-devel] [PULL 27/45] target/arm: Use gvec for NEON VDUP
+[PULL 029/117] target/arm: Introduce gen_gvec_ool_arg_zpzz
 From: Richard Henderson <richard.henderson@linaro.org>
-Also introduces neon_element_offset to find the env offset
+Use gen_gvec_ool_arg_zpzz instead of gen_gvec_ool_zzzp
-of a specific element within a neon register.
+when the arguments come from arg_rprr_esz.
 Replaces do_zpzz_ool.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-7-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-27-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 63 ++++++++++++++++++++++++------------------
+ target/arm/translate-sve.c | 21 +++++++++++----------
-file changed, 36 insertions(+), 27 deletions(-)
+file changed, 11 insertions(+), 10 deletions(-)
-diff --git a/target/arm/translate.c b/target/arm/translate.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ neon_reg_offset (int reg, int n)
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_zzzp(DisasContext *s, gen_helper_gvec_4 *fn,
-     return vfp_reg_offset(0, sreg);
+     return true;
  }
-+/* Return the offset of a 2**SIZE piece of a NEON register, at index ELE,
++static bool gen_gvec_ool_arg_zpzz(DisasContext *s, gen_helper_gvec_4 *fn,
-+ * where 0 is the least significant end of the register.
++                                  arg_rprr_esz *a, int data)
 + */
 +static inline long
 +neon_element_offset(int reg, int element, TCGMemOp size)
 +{
-+    int element_size = 1 << size;
++    return gen_gvec_ool_zzzp(s, fn, a->rd, a->rn, a->rm, a->pg, data);
 +    int ofs = element * element_size;
 +#ifdef HOST_WORDS_BIGENDIAN
 +    /* Calculate the offset assuming fully little-endian,
 +     * then XOR to account for the order of the 8-byte units.
 +     */
 +    if (element_size < 8) {
 +        ofs ^= 8 - element_size;
 +    }
 +#endif
 +    return neon_reg_offset(reg, 0) + ofs;
 +}
 +
- static TCGv_i32 neon_load_reg(int reg, int pass)
+ /* Invoke a vector expander on two Zregs.  */
- {
+ static void gen_gvec_fn_zz(DisasContext *s, GVecGen2Fn *gvec_fn,
-     TCGv_i32 tmp = tcg_temp_new_i32();
+                            int esz, int rd, int rn)
-@@ -XXX,XX +XXX,XX @@ static int disas_vfp_insn(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static bool trans_UQSUB_zzz(DisasContext *s, arg_rrr_esz *a)
-                     tmp = load_reg(s, rd);
+  *** SVE Integer Arithmetic - Binary Predicated Group
-                     if (insn & (1 << 23)) {
+  */
-                         /* VDUP */
--                        if (size == 0) {
+-static bool do_zpzz_ool(DisasContext *s, arg_rprr_esz *a, gen_helper_gvec_4 *fn)
--                            gen_neon_dup_u8(tmp, 0);
+-{
--                        } else if (size == 1) {
+-    return gen_gvec_ool_zzzp(s, fn, a->rd, a->rn, a->rm, a->pg, 0);
--                            gen_neon_dup_low16(tmp);
+-}
--                        }
+-
--                        for (n = 0; n <= pass * 2; n++) {
+ /* Select active elememnts from Zn and inactive elements from Zm,
--                            tmp2 = tcg_temp_new_i32();
+  * storing the result in Zd.
--                            tcg_gen_mov_i32(tmp2, tmp);
+  */
--                            neon_store_reg(rn, n, tmp2);
+@@ -XXX,XX +XXX,XX @@ static bool trans_##NAME##_zpzz(DisasContext *s, arg_rprr_esz *a)         \
--                        }
+         gen_helper_sve_##name##_zpzz_b, gen_helper_sve_##name##_zpzz_h,   \
--                        neon_store_reg(rn, n, tmp);
+         gen_helper_sve_##name##_zpzz_s, gen_helper_sve_##name##_zpzz_d,   \
-+                        int vec_size = pass ? 16 : 8;
+     };                                                                    \
-+                        tcg_gen_gvec_dup_i32(size, neon_reg_offset(rn, 0),
+-    return do_zpzz_ool(s, a, fns[a->esz]);                                \
-+                                             vec_size, vec_size, tmp);
++    return gen_gvec_ool_arg_zpzz(s, fns[a->esz], a, 0);                   \
-+                        tcg_temp_free_i32(tmp);
+ }
-                     } else {
-                         /* VMOV */
+ DO_ZPZZ(AND, and)
-                         switch (size) {
+@@ -XXX,XX +XXX,XX @@ static bool trans_SDIV_zpzz(DisasContext *s, arg_rprr_esz *a)
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+     static gen_helper_gvec_4 * const fns[4] = {
-                 tcg_temp_free_i32(tmp);
+         NULL, NULL, gen_helper_sve_sdiv_zpzz_s, gen_helper_sve_sdiv_zpzz_d
-             } else if ((insn & 0x380) == 0) {
+     };
-                 /* VDUP */
+-    return do_zpzz_ool(s, a, fns[a->esz]);
-+                int element;
++    return gen_gvec_ool_arg_zpzz(s, fns[a->esz], a, 0);
-+                TCGMemOp size;
+ }
-+
-                 if ((insn & (7 << 16)) == 0 || (q && (rd & 1))) {
+ static bool trans_UDIV_zpzz(DisasContext *s, arg_rprr_esz *a)
-                     return 1;
+@@ -XXX,XX +XXX,XX @@ static bool trans_UDIV_zpzz(DisasContext *s, arg_rprr_esz *a)
-                 }
+     static gen_helper_gvec_4 * const fns[4] = {
--                if (insn & (1 << 19)) {
+         NULL, NULL, gen_helper_sve_udiv_zpzz_s, gen_helper_sve_udiv_zpzz_d
--                    tmp = neon_load_reg(rm, 1);
+     };
--                } else {
+-    return do_zpzz_ool(s, a, fns[a->esz]);
--                    tmp = neon_load_reg(rm, 0);
++    return gen_gvec_ool_arg_zpzz(s, fns[a->esz], a, 0);
--                }
+ }
-                 if (insn & (1 << 16)) {
--                    gen_neon_dup_u8(tmp, ((insn >> 17) & 3) * 8);
+ static bool trans_SEL_zpzz(DisasContext *s, arg_rprr_esz *a)
-+                    size = MO_8;
+@@ -XXX,XX +XXX,XX @@ static bool trans_##NAME##_zpzw(DisasContext *s, arg_rprr_esz *a)         \
-+                    element = (insn >> 17) & 7;
+     if (a->esz < 0 || a->esz >= 3) {                                      \
-                 } else if (insn & (1 << 17)) {
+         return false;                                                     \
--                    if ((insn >> 18) & 1)
+     }                                                                     \
--                        gen_neon_dup_high16(tmp);
+-    return do_zpzz_ool(s, a, fns[a->esz]);                                \
--                    else
++    return gen_gvec_ool_arg_zpzz(s, fns[a->esz], a, 0);                   \
--                        gen_neon_dup_low16(tmp);
+ }
-+                    size = MO_16;
-+                    element = (insn >> 18) & 3;
+ DO_ZPZW(ASR, asr)
-+                } else {
+@@ -XXX,XX +XXX,XX @@ static bool do_sve2_zpzz_ool(DisasContext *s, arg_rprr_esz *a,
-+                    size = MO_32;
+     if (!dc_isar_feature(aa64_sve2, s)) {
-+                    element = (insn >> 19) & 1;
+         return false;
-                 }
+     }
--                for (pass = 0; pass < (q ? 4 : 2); pass++) {
+-    return do_zpzz_ool(s, a, fn);
--                    tmp2 = tcg_temp_new_i32();
++    return gen_gvec_ool_arg_zpzz(s, fn, a, 0);
--                    tcg_gen_mov_i32(tmp2, tmp);
+ }
--                    neon_store_reg(rd, pass, tmp2);
--                }
+ static bool trans_SADALP_zpzz(DisasContext *s, arg_rprr_esz *a)
 -                tcg_temp_free_i32(tmp);
 +                tcg_gen_gvec_dup_mem(size, neon_reg_offset(rd, 0),
 +                                     neon_element_offset(rm, element, size),
 +                                     q ? 16 : 8, q ? 16 : 8);
              } else {
                  return 1;
              }
 --
-.19.1
+.25.1

-New patch
+[PULL 030/117] target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zpzz
+From: Richard Henderson <richard.henderson@linaro.org>
+Convert SVE translation functions directly using
+gen_gvec_ool_arg_zpzz to TRANS_FEAT.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-28-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 85 ++++++++++++++++----------------------
+file changed, 36 insertions(+), 49 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static void do_sel_z(DisasContext *s, int rd, int rn, int rm, int pg, int esz)
+     gen_gvec_ool_zzzp(s, fns[esz], rd, rn, rm, pg, 0);
+ }
+-#define DO_ZPZZ(NAME, name) \
+-static bool trans_##NAME##_zpzz(DisasContext *s, arg_rprr_esz *a)         \
+-{                                                                         \
+-    static gen_helper_gvec_4 * const fns[4] = {                           \
+-        gen_helper_sve_##name##_zpzz_b, gen_helper_sve_##name##_zpzz_h,   \
+-        gen_helper_sve_##name##_zpzz_s, gen_helper_sve_##name##_zpzz_d,   \
++#define DO_ZPZZ(NAME, FEAT, name) \
++    static gen_helper_gvec_4 * const name##_zpzz_fns[4] = {               \
++        gen_helper_##name##_zpzz_b, gen_helper_##name##_zpzz_h,           \
++        gen_helper_##name##_zpzz_s, gen_helper_##name##_zpzz_d,           \
+     };                                                                    \
+-    return gen_gvec_ool_arg_zpzz(s, fns[a->esz], a, 0);                   \
+-}
++    TRANS_FEAT(NAME, FEAT, gen_gvec_ool_arg_zpzz,                         \
++               name##_zpzz_fns[a->esz], a, 0)
+-DO_ZPZZ(AND, and)
+-DO_ZPZZ(EOR, eor)
+-DO_ZPZZ(ORR, orr)
+-DO_ZPZZ(BIC, bic)
++DO_ZPZZ(AND_zpzz, aa64_sve, sve_and)
++DO_ZPZZ(EOR_zpzz, aa64_sve, sve_eor)
++DO_ZPZZ(ORR_zpzz, aa64_sve, sve_orr)
++DO_ZPZZ(BIC_zpzz, aa64_sve, sve_bic)
+-DO_ZPZZ(ADD, add)
+-DO_ZPZZ(SUB, sub)
++DO_ZPZZ(ADD_zpzz, aa64_sve, sve_add)
++DO_ZPZZ(SUB_zpzz, aa64_sve, sve_sub)
+-DO_ZPZZ(SMAX, smax)
+-DO_ZPZZ(UMAX, umax)
+-DO_ZPZZ(SMIN, smin)
+-DO_ZPZZ(UMIN, umin)
+-DO_ZPZZ(SABD, sabd)
+-DO_ZPZZ(UABD, uabd)
++DO_ZPZZ(SMAX_zpzz, aa64_sve, sve_smax)
++DO_ZPZZ(UMAX_zpzz, aa64_sve, sve_umax)
++DO_ZPZZ(SMIN_zpzz, aa64_sve, sve_smin)
++DO_ZPZZ(UMIN_zpzz, aa64_sve, sve_umin)
++DO_ZPZZ(SABD_zpzz, aa64_sve, sve_sabd)
++DO_ZPZZ(UABD_zpzz, aa64_sve, sve_uabd)
+-DO_ZPZZ(MUL, mul)
+-DO_ZPZZ(SMULH, smulh)
+-DO_ZPZZ(UMULH, umulh)
++DO_ZPZZ(MUL_zpzz, aa64_sve, sve_mul)
++DO_ZPZZ(SMULH_zpzz, aa64_sve, sve_smulh)
++DO_ZPZZ(UMULH_zpzz, aa64_sve, sve_umulh)
+-DO_ZPZZ(ASR, asr)
+-DO_ZPZZ(LSR, lsr)
+-DO_ZPZZ(LSL, lsl)
++DO_ZPZZ(ASR_zpzz, aa64_sve, sve_asr)
++DO_ZPZZ(LSR_zpzz, aa64_sve, sve_lsr)
++DO_ZPZZ(LSL_zpzz, aa64_sve, sve_lsl)
+-static bool trans_SDIV_zpzz(DisasContext *s, arg_rprr_esz *a)
+-{
+-    static gen_helper_gvec_4 * const fns[4] = {
+-        NULL, NULL, gen_helper_sve_sdiv_zpzz_s, gen_helper_sve_sdiv_zpzz_d
+-    };
+-    return gen_gvec_ool_arg_zpzz(s, fns[a->esz], a, 0);
+-}
++static gen_helper_gvec_4 * const sdiv_fns[4] = {
++    NULL, NULL, gen_helper_sve_sdiv_zpzz_s, gen_helper_sve_sdiv_zpzz_d
++};
++TRANS_FEAT(SDIV_zpzz, aa64_sve, gen_gvec_ool_arg_zpzz, sdiv_fns[a->esz], a, 0)
+-static bool trans_UDIV_zpzz(DisasContext *s, arg_rprr_esz *a)
+-{
+-    static gen_helper_gvec_4 * const fns[4] = {
+-        NULL, NULL, gen_helper_sve_udiv_zpzz_s, gen_helper_sve_udiv_zpzz_d
+-    };
+-    return gen_gvec_ool_arg_zpzz(s, fns[a->esz], a, 0);
+-}
++static gen_helper_gvec_4 * const udiv_fns[4] = {
++    NULL, NULL, gen_helper_sve_udiv_zpzz_s, gen_helper_sve_udiv_zpzz_d
++};
++TRANS_FEAT(UDIV_zpzz, aa64_sve, gen_gvec_ool_arg_zpzz, udiv_fns[a->esz], a, 0)
+ static bool trans_SEL_zpzz(DisasContext *s, arg_rprr_esz *a)
+ {
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(SQSHLU, aa64_sve2, gen_gvec_ool_arg_zpzi,
+  */
+ #define DO_ZPZW(NAME, name) \
+-static bool trans_##NAME##_zpzw(DisasContext *s, arg_rprr_esz *a)         \
+-{                                                                         \
+-    static gen_helper_gvec_4 * const fns[3] = {                           \
++    static gen_helper_gvec_4 * const name##_zpzw_fns[4] = {               \
+         gen_helper_sve_##name##_zpzw_b, gen_helper_sve_##name##_zpzw_h,   \
+-        gen_helper_sve_##name##_zpzw_s,                                   \
++        gen_helper_sve_##name##_zpzw_s, NULL                              \
+     };                                                                    \
+-    if (a->esz < 0 || a->esz >= 3) {                                      \
+-        return false;                                                     \
+-    }                                                                     \
+-    return gen_gvec_ool_arg_zpzz(s, fns[a->esz], a, 0);                   \
+-}
++    TRANS_FEAT(NAME##_zpzw, aa64_sve, gen_gvec_ool_arg_zpzz,              \
++               a->esz < 0 ? NULL : name##_zpzw_fns[a->esz], a, 0)
+ DO_ZPZW(ASR, asr)
+ DO_ZPZW(LSR, lsr)
+--
+.25.1

-New patch
+[PULL 031/117] target/arm: Use TRANS_FEAT for do_sve2_zpzz_ool
+From: Richard Henderson <richard.henderson@linaro.org>
+Convert SVE translation functions using do_sve2_zpzz_ool
+to use TRANS_FEAT and gen_gvec_ool_arg_zpzz.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-29-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 118 +++++++++++++------------------------
+file changed, 40 insertions(+), 78 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool trans_SEL_zpzz(DisasContext *s, arg_rprr_esz *a)
+     return true;
+ }
+-#undef DO_ZPZZ
+-
+ /*
+  *** SVE Integer Arithmetic - Unary Predicated Group
+  */
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(SQRDMULH_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
+  * SVE2 Integer - Predicated
+  */
+-static bool do_sve2_zpzz_ool(DisasContext *s, arg_rprr_esz *a,
+-                             gen_helper_gvec_4 *fn)
+-{
+-    if (!dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_arg_zpzz(s, fn, a, 0);
+-}
++static gen_helper_gvec_4 * const sadlp_fns[4] = {
++    NULL,                          gen_helper_sve2_sadalp_zpzz_h,
++    gen_helper_sve2_sadalp_zpzz_s, gen_helper_sve2_sadalp_zpzz_d,
++};
++TRANS_FEAT(SADALP_zpzz, aa64_sve2, gen_gvec_ool_arg_zpzz,
++           sadlp_fns[a->esz], a, 0)
+-static bool trans_SADALP_zpzz(DisasContext *s, arg_rprr_esz *a)
+-{
+-    static gen_helper_gvec_4 * const fns[3] = {
+-        gen_helper_sve2_sadalp_zpzz_h,
+-        gen_helper_sve2_sadalp_zpzz_s,
+-        gen_helper_sve2_sadalp_zpzz_d,
+-    };
+-    if (a->esz == 0) {
+-        return false;
+-    }
+-    return do_sve2_zpzz_ool(s, a, fns[a->esz - 1]);
+-}
+-
+-static bool trans_UADALP_zpzz(DisasContext *s, arg_rprr_esz *a)
+-{
+-    static gen_helper_gvec_4 * const fns[3] = {
+-        gen_helper_sve2_uadalp_zpzz_h,
+-        gen_helper_sve2_uadalp_zpzz_s,
+-        gen_helper_sve2_uadalp_zpzz_d,
+-    };
+-    if (a->esz == 0) {
+-        return false;
+-    }
+-    return do_sve2_zpzz_ool(s, a, fns[a->esz - 1]);
+-}
++static gen_helper_gvec_4 * const uadlp_fns[4] = {
++    NULL,                          gen_helper_sve2_uadalp_zpzz_h,
++    gen_helper_sve2_uadalp_zpzz_s, gen_helper_sve2_uadalp_zpzz_d,
++};
++TRANS_FEAT(UADALP_zpzz, aa64_sve2, gen_gvec_ool_arg_zpzz,
++           uadlp_fns[a->esz], a, 0)
+ /*
+  * SVE2 integer unary operations (predicated)
+@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_3 * const sqneg_fns[4] = {
+ };
+ TRANS_FEAT(SQNEG, aa64_sve2, gen_gvec_ool_arg_zpz, sqneg_fns[a->esz], a, 0)
+-#define DO_SVE2_ZPZZ(NAME, name) \
+-static bool trans_##NAME(DisasContext *s, arg_rprr_esz *a)                \
+-{                                                                         \
+-    static gen_helper_gvec_4 * const fns[4] = {                           \
+-        gen_helper_sve2_##name##_zpzz_b, gen_helper_sve2_##name##_zpzz_h, \
+-        gen_helper_sve2_##name##_zpzz_s, gen_helper_sve2_##name##_zpzz_d, \
+-    };                                                                    \
+-    return do_sve2_zpzz_ool(s, a, fns[a->esz]);                           \
+-}
++DO_ZPZZ(SQSHL, aa64_sve2, sve2_sqshl)
++DO_ZPZZ(SQRSHL, aa64_sve2, sve2_sqrshl)
++DO_ZPZZ(SRSHL, aa64_sve2, sve2_srshl)
+-DO_SVE2_ZPZZ(SQSHL, sqshl)
+-DO_SVE2_ZPZZ(SQRSHL, sqrshl)
+-DO_SVE2_ZPZZ(SRSHL, srshl)
++DO_ZPZZ(UQSHL, aa64_sve2, sve2_uqshl)
++DO_ZPZZ(UQRSHL, aa64_sve2, sve2_uqrshl)
++DO_ZPZZ(URSHL, aa64_sve2, sve2_urshl)
+-DO_SVE2_ZPZZ(UQSHL, uqshl)
+-DO_SVE2_ZPZZ(UQRSHL, uqrshl)
+-DO_SVE2_ZPZZ(URSHL, urshl)
++DO_ZPZZ(SHADD, aa64_sve2, sve2_shadd)
++DO_ZPZZ(SRHADD, aa64_sve2, sve2_srhadd)
++DO_ZPZZ(SHSUB, aa64_sve2, sve2_shsub)
+-DO_SVE2_ZPZZ(SHADD, shadd)
+-DO_SVE2_ZPZZ(SRHADD, srhadd)
+-DO_SVE2_ZPZZ(SHSUB, shsub)
++DO_ZPZZ(UHADD, aa64_sve2, sve2_uhadd)
++DO_ZPZZ(URHADD, aa64_sve2, sve2_urhadd)
++DO_ZPZZ(UHSUB, aa64_sve2, sve2_uhsub)
+-DO_SVE2_ZPZZ(UHADD, uhadd)
+-DO_SVE2_ZPZZ(URHADD, urhadd)
+-DO_SVE2_ZPZZ(UHSUB, uhsub)
++DO_ZPZZ(ADDP, aa64_sve2, sve2_addp)
++DO_ZPZZ(SMAXP, aa64_sve2, sve2_smaxp)
++DO_ZPZZ(UMAXP, aa64_sve2, sve2_umaxp)
++DO_ZPZZ(SMINP, aa64_sve2, sve2_sminp)
++DO_ZPZZ(UMINP, aa64_sve2, sve2_uminp)
+-DO_SVE2_ZPZZ(ADDP, addp)
+-DO_SVE2_ZPZZ(SMAXP, smaxp)
+-DO_SVE2_ZPZZ(UMAXP, umaxp)
+-DO_SVE2_ZPZZ(SMINP, sminp)
+-DO_SVE2_ZPZZ(UMINP, uminp)
+-
+-DO_SVE2_ZPZZ(SQADD_zpzz, sqadd)
+-DO_SVE2_ZPZZ(UQADD_zpzz, uqadd)
+-DO_SVE2_ZPZZ(SQSUB_zpzz, sqsub)
+-DO_SVE2_ZPZZ(UQSUB_zpzz, uqsub)
+-DO_SVE2_ZPZZ(SUQADD, suqadd)
+-DO_SVE2_ZPZZ(USQADD, usqadd)
++DO_ZPZZ(SQADD_zpzz, aa64_sve2, sve2_sqadd)
++DO_ZPZZ(UQADD_zpzz, aa64_sve2, sve2_uqadd)
++DO_ZPZZ(SQSUB_zpzz, aa64_sve2, sve2_sqsub)
++DO_ZPZZ(UQSUB_zpzz, aa64_sve2, sve2_uqsub)
++DO_ZPZZ(SUQADD, aa64_sve2, sve2_suqadd)
++DO_ZPZZ(USQADD, aa64_sve2, sve2_usqadd)
+ /*
+  * SVE2 Widening Integer Arithmetic
+@@ -XXX,XX +XXX,XX @@ static bool trans_##NAME(DisasContext *s, arg_rprr_esz *a)                  \
+ DO_SVE2_PPZZ_MATCH(MATCH, match)
+ DO_SVE2_PPZZ_MATCH(NMATCH, nmatch)
+-static bool trans_HISTCNT(DisasContext *s, arg_rprr_esz *a)
+-{
+-    static gen_helper_gvec_4 * const fns[2] = {
+-        gen_helper_sve2_histcnt_s, gen_helper_sve2_histcnt_d
+-    };
+-    if (a->esz < 2) {
+-        return false;
+-    }
+-    return do_sve2_zpzz_ool(s, a, fns[a->esz - 2]);
+-}
++static gen_helper_gvec_4 * const histcnt_fns[4] = {
++    NULL, NULL, gen_helper_sve2_histcnt_s, gen_helper_sve2_histcnt_d
++};
++TRANS_FEAT(HISTCNT, aa64_sve2, gen_gvec_ool_arg_zpzz,
++           histcnt_fns[a->esz], a, 0)
+ TRANS_FEAT(HISTSEG, aa64_sve2, gen_gvec_ool_arg_zzz,
+            a->esz == 0 ? gen_helper_sve2_histseg : NULL, a, 0)
+--
+.25.1

-New patch
+[PULL 032/117] target/arm: Merge gen_gvec_fn_zz into do_mov_z
+From: Richard Henderson <richard.henderson@linaro.org>
+There is only one caller for gen_gvec_fn_zz; inline it.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-30-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 13 +++----------
+file changed, 3 insertions(+), 10 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_arg_zpzz(DisasContext *s, gen_helper_gvec_4 *fn,
+     return gen_gvec_ool_zzzp(s, fn, a->rd, a->rn, a->rm, a->pg, data);
+ }
+-/* Invoke a vector expander on two Zregs.  */
+-static void gen_gvec_fn_zz(DisasContext *s, GVecGen2Fn *gvec_fn,
+-                           int esz, int rd, int rn)
+-{
+-    unsigned vsz = vec_full_reg_size(s);
+-    gvec_fn(esz, vec_full_reg_offset(s, rd),
+-            vec_full_reg_offset(s, rn), vsz, vsz);
+-}
+-
+ /* Invoke a vector expander on three Zregs.  */
+ static void gen_gvec_fn_zzz(DisasContext *s, GVecGen3Fn *gvec_fn,
+                             int esz, int rd, int rn, int rm)
+@@ -XXX,XX +XXX,XX @@ static void gen_gvec_fn_zzzz(DisasContext *s, GVecGen4Fn *gvec_fn,
+ static bool do_mov_z(DisasContext *s, int rd, int rn)
+ {
+     if (sve_access_check(s)) {
+-        gen_gvec_fn_zz(s, tcg_gen_gvec_mov, MO_8, rd, rn);
++        unsigned vsz = vec_full_reg_size(s);
++        tcg_gen_gvec_mov(MO_8, vec_full_reg_offset(s, rd),
++                         vec_full_reg_offset(s, rn), vsz, vsz);
+     }
+     return true;
+ }
+--
+.25.1

-New patch
+[PULL 033/117] target/arm: Move null function and sve check into gen_gvec_fn_zzz
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-31-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 36 +++++++++++++++---------------------
+file changed, 15 insertions(+), 21 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_arg_zpzz(DisasContext *s, gen_helper_gvec_4 *fn,
+ }
+ /* Invoke a vector expander on three Zregs.  */
+-static void gen_gvec_fn_zzz(DisasContext *s, GVecGen3Fn *gvec_fn,
++static bool gen_gvec_fn_zzz(DisasContext *s, GVecGen3Fn *gvec_fn,
+                             int esz, int rd, int rn, int rm)
+ {
+-    unsigned vsz = vec_full_reg_size(s);
+-    gvec_fn(esz, vec_full_reg_offset(s, rd),
+-            vec_full_reg_offset(s, rn),
+-            vec_full_reg_offset(s, rm), vsz, vsz);
++    if (gvec_fn == NULL) {
++        return false;
++    }
++    if (sve_access_check(s)) {
++        unsigned vsz = vec_full_reg_size(s);
++        gvec_fn(esz, vec_full_reg_offset(s, rd),
++                vec_full_reg_offset(s, rn),
++                vec_full_reg_offset(s, rm), vsz, vsz);
++    }
++    return true;
+ }
+ /* Invoke a vector expander on four Zregs.  */
+@@ -XXX,XX +XXX,XX @@ const uint64_t pred_esz_masks[4] = {
+ static bool do_zzz_fn(DisasContext *s, arg_rrr_esz *a, GVecGen3Fn *gvec_fn)
+ {
+-    if (sve_access_check(s)) {
+-        gen_gvec_fn_zzz(s, gvec_fn, a->esz, a->rd, a->rn, a->rm);
+-    }
+-    return true;
++    return gen_gvec_fn_zzz(s, gvec_fn, a->esz, a->rd, a->rn, a->rm);
+ }
+ static bool trans_AND_zzz(DisasContext *s, arg_rrr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_MUL_zzz(DisasContext *s, arg_rrr_esz *a)
+     if (!dc_isar_feature(aa64_sve2, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_fn_zzz(s, tcg_gen_gvec_mul, a->esz, a->rd, a->rn, a->rm);
+-    }
+-    return true;
++    return gen_gvec_fn_zzz(s, tcg_gen_gvec_mul, a->esz, a->rd, a->rn, a->rm);
+ }
+ static gen_helper_gvec_3 * const smulh_zzz_fns[4] = {
+@@ -XXX,XX +XXX,XX @@ static bool do_sve2_fn_zzz(DisasContext *s, arg_rrr_esz *a, GVecGen3Fn *fn)
+     if (!dc_isar_feature(aa64_sve2, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_fn_zzz(s, fn, a->esz, a->rd, a->rn, a->rm);
+-    }
+-    return true;
++    return gen_gvec_fn_zzz(s, fn, a->esz, a->rd, a->rn, a->rm);
+ }
+ static bool trans_SABA(DisasContext *s, arg_rrr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_RAX1(DisasContext *s, arg_rrr_esz *a)
+     if (!dc_isar_feature(aa64_sve2_sha3, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_fn_zzz(s, gen_gvec_rax1, MO_64, a->rd, a->rn, a->rm);
+-    }
+-    return true;
++    return gen_gvec_fn_zzz(s, gen_gvec_rax1, MO_64, a->rd, a->rn, a->rm);
+ }
+ static bool trans_FCVTNT_sh(DisasContext *s, arg_rpr_esz *a)
+--
+.25.1

-[Qemu-devel] [PULL 02/45] target/arm: Add support for VCPU event states
+[PULL 034/117] target/arm: Rename do_zzz_fn to gen_gvec_fn_arg_zzz
-From: Dongjiu Geng <gengdongjiu@huawei.com>
+From: Richard Henderson <richard.henderson@linaro.org>
-This patch extends the qemu-kvm state sync logic with support for
+Rename the function to match gen_gvec_fn_zzz,
-KVM_GET/SET_VCPU_EVENTS, giving access to yet missing SError exception.
+and move to be adjacent.
 And also it can support the exception state migration.
-The SError exception states include SError pending state and ESR value,
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-the kvm_put/get_vcpu_events() will be called when set or get system
+Message-id: 20220527181907.189259-32-richard.henderson@linaro.org
 registers. When do migration, if source machine has SError pending,
 QEMU will do this migration regardless whether the target machine supports
 to specify guest ESR value, because if target machine does not support that,
 it can also inject the SError with zero ESR value.
 Signed-off-by: Dongjiu Geng <gengdongjiu@huawei.com>
 Reviewed-by: Andrew Jones <drjones@redhat.com>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Message-id: 1538067351-23931-3-git-send-email-gengdongjiu@huawei.com
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.h     |  7 ++++++
+ target/arm/translate-sve.c | 31 ++++++++++++++++---------------
- target/arm/kvm_arm.h | 24 ++++++++++++++++++
+file changed, 16 insertions(+), 15 deletions(-)
  target/arm/kvm.c     | 60 ++++++++++++++++++++++++++++++++++++++++++++
  target/arm/kvm32.c   | 13 ++++++++++
  target/arm/kvm64.c   | 13 ++++++++++
  target/arm/machine.c | 22 ++++++++++++++++
 files changed, 139 insertions(+)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/cpu.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ typedef struct CPUARMState {
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_fn_zzz(DisasContext *s, GVecGen3Fn *gvec_fn,
-          */
+     return true;
      } exception;
 +    /* Information associated with an SError */
 +    struct {
 +        uint8_t pending;
 +        uint8_t has_esr;
 +        uint64_t esr;
 +    } serror;
 +
      /* Thumb-2 EE state.  */
      uint32_t teecr;
      uint32_t teehbr;
 diff --git a/target/arm/kvm_arm.h b/target/arm/kvm_arm.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/kvm_arm.h
 +++ b/target/arm/kvm_arm.h
@@ -XXX,XX +XXX,XX @@ bool write_kvmstate_to_list(ARMCPU *cpu);
   */
  void kvm_arm_reset_vcpu(ARMCPU *cpu);
 +/**
 + * kvm_arm_init_serror_injection:
 + * @cs: CPUState
 + *
 + * Check whether KVM can set guest SError syndrome.
 + */
 +void kvm_arm_init_serror_injection(CPUState *cs);
 +
 +/**
 + * kvm_get_vcpu_events:
 + * @cpu: ARMCPU
 + *
 + * Get VCPU related state from kvm.
 + */
 +int kvm_get_vcpu_events(ARMCPU *cpu);
 +
 +/**
 + * kvm_put_vcpu_events:
 + * @cpu: ARMCPU
 + *
 + * Put VCPU related state to kvm.
 + */
 +int kvm_put_vcpu_events(ARMCPU *cpu);
 +
  #ifdef CONFIG_KVM
  /**
   * kvm_arm_create_scratch_host_vcpu:
 diff --git a/target/arm/kvm.c b/target/arm/kvm.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/kvm.c
 +++ b/target/arm/kvm.c
@@ -XXX,XX +XXX,XX @@ const KVMCapabilityInfo kvm_arch_required_capabilities[] = {
  };
  static bool cap_has_mp_state;
 +static bool cap_has_inject_serror_esr;
  static ARMHostCPUFeatures arm_host_cpu_features;
@@ -XXX,XX +XXX,XX @@ int kvm_arm_vcpu_init(CPUState *cs)
      return kvm_vcpu_ioctl(cs, KVM_ARM_VCPU_INIT, &init);
  }
-+void kvm_arm_init_serror_injection(CPUState *cs)
++static bool gen_gvec_fn_arg_zzz(DisasContext *s, GVecGen3Fn *fn,
 +                                arg_rrr_esz *a)
 +{
-+    cap_has_inject_serror_esr = kvm_check_extension(cs->kvm_state,
++    return gen_gvec_fn_zzz(s, fn, a->esz, a->rd, a->rn, a->rm);
 +                                    KVM_CAP_ARM_INJECT_SERROR_ESR);
 +}
 +
- bool kvm_arm_create_scratch_host_vcpu(const uint32_t *cpus_to_try,
+ /* Invoke a vector expander on four Zregs.  */
-                                       int *fdarray,
+ static void gen_gvec_fn_zzzz(DisasContext *s, GVecGen4Fn *gvec_fn,
-                                       struct kvm_vcpu_init *init)
+                              int esz, int rd, int rn, int rm, int ra)
-@@ -XXX,XX +XXX,XX @@ int kvm_arm_sync_mpstate_to_qemu(ARMCPU *cpu)
+@@ -XXX,XX +XXX,XX @@ const uint64_t pred_esz_masks[4] = {
-     return 0;
+  *** SVE Logical - Unpredicated Group
   */
 -static bool do_zzz_fn(DisasContext *s, arg_rrr_esz *a, GVecGen3Fn *gvec_fn)
 -{
 -    return gen_gvec_fn_zzz(s, gvec_fn, a->esz, a->rd, a->rn, a->rm);
 -}
 -
  static bool trans_AND_zzz(DisasContext *s, arg_rrr_esz *a)
  {
 -    return do_zzz_fn(s, a, tcg_gen_gvec_and);
 +    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_and, a);
  }
-+int kvm_put_vcpu_events(ARMCPU *cpu)
+ static bool trans_ORR_zzz(DisasContext *s, arg_rrr_esz *a)
 +{
 +    CPUARMState *env = &cpu->env;
 +    struct kvm_vcpu_events events;
 +    int ret;
 +
 +    if (!kvm_has_vcpu_events()) {
 +        return 0;
 +    }
 +
 +    memset(&events, 0, sizeof(events));
 +    events.exception.serror_pending = env->serror.pending;
 +
 +    /* Inject SError to guest with specified syndrome if host kernel
 +     * supports it, otherwise inject SError without syndrome.
 +     */
 +    if (cap_has_inject_serror_esr) {
 +        events.exception.serror_has_esr = env->serror.has_esr;
 +        events.exception.serror_esr = env->serror.esr;
 +    }
 +
 +    ret = kvm_vcpu_ioctl(CPU(cpu), KVM_SET_VCPU_EVENTS, &events);
 +    if (ret) {
 +        error_report("failed to put vcpu events");
 +    }
 +
 +    return ret;
 +}
 +
 +int kvm_get_vcpu_events(ARMCPU *cpu)
 +{
 +    CPUARMState *env = &cpu->env;
 +    struct kvm_vcpu_events events;
 +    int ret;
 +
 +    if (!kvm_has_vcpu_events()) {
 +        return 0;
 +    }
 +
 +    memset(&events, 0, sizeof(events));
 +    ret = kvm_vcpu_ioctl(CPU(cpu), KVM_GET_VCPU_EVENTS, &events);
 +    if (ret) {
 +        error_report("failed to get vcpu events");
 +        return ret;
 +    }
 +
 +    env->serror.pending = events.exception.serror_pending;
 +    env->serror.has_esr = events.exception.serror_has_esr;
 +    env->serror.esr = events.exception.serror_esr;
 +
 +    return 0;
 +}
 +
  void kvm_arch_pre_run(CPUState *cs, struct kvm_run *run)
  {
+-    return do_zzz_fn(s, a, tcg_gen_gvec_or);
++    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_or, a);
  }
-diff --git a/target/arm/kvm32.c b/target/arm/kvm32.c
-index XXXXXXX..XXXXXXX 100644
+ static bool trans_EOR_zzz(DisasContext *s, arg_rrr_esz *a)
---- a/target/arm/kvm32.c
+ {
-+++ b/target/arm/kvm32.c
+-    return do_zzz_fn(s, a, tcg_gen_gvec_xor);
-@@ -XXX,XX +XXX,XX @@ int kvm_arch_init_vcpu(CPUState *cs)
++    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_xor, a);
      }
      cpu->mp_affinity = mpidr & ARM32_AFFINITY_MASK;
 +    /* Check whether userspace can specify guest syndrome value */
 +    kvm_arm_init_serror_injection(cs);
 +
      return kvm_arm_init_cpreg_list(cpu);
  }
-@@ -XXX,XX +XXX,XX @@ int kvm_arch_put_registers(CPUState *cs, int level)
+ static bool trans_BIC_zzz(DisasContext *s, arg_rrr_esz *a)
-         return ret;
+ {
-     }
+-    return do_zzz_fn(s, a, tcg_gen_gvec_andc);
++    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_andc, a);
 +    ret = kvm_put_vcpu_events(cpu);
 +    if (ret) {
 +        return ret;
 +    }
 +
      /* Note that we do not call write_cpustate_to_list()
       * here, so we are only writing the tuple list back to
       * KVM. This is safe because nothing can change the
@@ -XXX,XX +XXX,XX @@ int kvm_arch_get_registers(CPUState *cs)
      }
      vfp_set_fpscr(env, fpscr);
 +    ret = kvm_get_vcpu_events(cpu);
 +    if (ret) {
 +        return ret;
 +    }
 +
      if (!write_kvmstate_to_list(cpu)) {
          return EINVAL;
      }
 diff --git a/target/arm/kvm64.c b/target/arm/kvm64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/kvm64.c
 +++ b/target/arm/kvm64.c
@@ -XXX,XX +XXX,XX @@ int kvm_arch_init_vcpu(CPUState *cs)
      kvm_arm_init_debug(cs);
 +    /* Check whether user space can specify guest syndrome value */
 +    kvm_arm_init_serror_injection(cs);
 +
      return kvm_arm_init_cpreg_list(cpu);
  }
-@@ -XXX,XX +XXX,XX @@ int kvm_arch_put_registers(CPUState *cs, int level)
+ static void gen_xar8_i64(TCGv_i64 d, TCGv_i64 n, TCGv_i64 m, int64_t sh)
-         return ret;
+@@ -XXX,XX +XXX,XX @@ static bool trans_NBSL(DisasContext *s, arg_rrrr_esz *a)
-     }
+ static bool trans_ADD_zzz(DisasContext *s, arg_rrr_esz *a)
 +    ret = kvm_put_vcpu_events(cpu);
 +    if (ret) {
 +        return ret;
 +    }
 +
      if (!write_list_to_kvmstate(cpu, level)) {
          return EINVAL;
      }
@@ -XXX,XX +XXX,XX @@ int kvm_arch_get_registers(CPUState *cs)
      }
      vfp_set_fpcr(env, fpr);
 +    ret = kvm_get_vcpu_events(cpu);
 +    if (ret) {
 +        return ret;
 +    }
 +
      if (!write_kvmstate_to_list(cpu)) {
          return EINVAL;
      }
 diff --git a/target/arm/machine.c b/target/arm/machine.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/machine.c
 +++ b/target/arm/machine.c
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_sve = {
  };
  #endif /* AARCH64 */
 +static bool serror_needed(void *opaque)
 +{
 +    ARMCPU *cpu = opaque;
 +    CPUARMState *env = &cpu->env;
 +
 +    return env->serror.pending != 0;
 +}
 +
 +static const VMStateDescription vmstate_serror = {
 +    .name = "cpu/serror",
 +    .version_id = 1,
 +    .minimum_version_id = 1,
 +    .needed = serror_needed,
 +    .fields = (VMStateField[]) {
 +        VMSTATE_UINT8(env.serror.pending, ARMCPU),
 +        VMSTATE_UINT8(env.serror.has_esr, ARMCPU),
 +        VMSTATE_UINT64(env.serror.esr, ARMCPU),
 +        VMSTATE_END_OF_LIST()
 +    }
 +};
 +
  static bool m_needed(void *opaque)
  {
-     ARMCPU *cpu = opaque;
+-    return do_zzz_fn(s, a, tcg_gen_gvec_add);
-@@ -XXX,XX +XXX,XX @@ const VMStateDescription vmstate_arm_cpu = {
++    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_add, a);
- #ifdef TARGET_AARCH64
+ }
-         &vmstate_sve,
- #endif
+ static bool trans_SUB_zzz(DisasContext *s, arg_rrr_esz *a)
-+        &vmstate_serror,
+ {
-         NULL
+-    return do_zzz_fn(s, a, tcg_gen_gvec_sub);
-     }
++    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_sub, a);
- };
+ }
  static bool trans_SQADD_zzz(DisasContext *s, arg_rrr_esz *a)
  {
 -    return do_zzz_fn(s, a, tcg_gen_gvec_ssadd);
 +    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_ssadd, a);
  }
  static bool trans_SQSUB_zzz(DisasContext *s, arg_rrr_esz *a)
  {
 -    return do_zzz_fn(s, a, tcg_gen_gvec_sssub);
 +    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_sssub, a);
  }
  static bool trans_UQADD_zzz(DisasContext *s, arg_rrr_esz *a)
  {
 -    return do_zzz_fn(s, a, tcg_gen_gvec_usadd);
 +    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_usadd, a);
  }
  static bool trans_UQSUB_zzz(DisasContext *s, arg_rrr_esz *a)
  {
 -    return do_zzz_fn(s, a, tcg_gen_gvec_ussub);
 +    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_ussub, a);
  }
  /*
 --
-.19.1
+.25.1

-New patch
+[PULL 035/117] target/arm: More use of gen_gvec_fn_arg_zzz
+From: Richard Henderson <richard.henderson@linaro.org>
+Two uses of gen_gvec_fn_zzz can pass on arg_rrr_esz instead.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-33-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 4 ++--
+file changed, 2 insertions(+), 2 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool trans_MUL_zzz(DisasContext *s, arg_rrr_esz *a)
+     if (!dc_isar_feature(aa64_sve2, s)) {
+         return false;
+     }
+-    return gen_gvec_fn_zzz(s, tcg_gen_gvec_mul, a->esz, a->rd, a->rn, a->rm);
++    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_mul, a);
+ }
+ static gen_helper_gvec_3 * const smulh_zzz_fns[4] = {
+@@ -XXX,XX +XXX,XX @@ static bool do_sve2_fn_zzz(DisasContext *s, arg_rrr_esz *a, GVecGen3Fn *fn)
+     if (!dc_isar_feature(aa64_sve2, s)) {
+         return false;
+     }
+-    return gen_gvec_fn_zzz(s, fn, a->esz, a->rd, a->rn, a->rm);
++    return gen_gvec_fn_arg_zzz(s, fn, a);
+ }
+ static bool trans_SABA(DisasContext *s, arg_rrr_esz *a)
+--
+.25.1

-[Qemu-devel] [PULL 35/45] target/arm: Use gvec for VSRI, VSLI
+[PULL 036/117] target/arm: Use TRANS_FEAT for gen_gvec_fn_arg_zzz
 From: Richard Henderson <richard.henderson@linaro.org>
-Move shi_op and sli_op expanders from translate-a64.c.
+Convert SVE translation functions directly using
 gen_gvec_fn_arg_zzz to TRANS_FEAT.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-15-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-34-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.h     |   2 +
+ target/arm/translate-sve.c | 66 +++++++-------------------------------
- target/arm/translate-a64.c | 152 +----------------------
+file changed, 11 insertions(+), 55 deletions(-)
  target/arm/translate.c     | 244 ++++++++++++++++++++++++++-----------
 files changed, 179 insertions(+), 219 deletions(-)
-diff --git a/target/arm/translate.h b/target/arm/translate.h
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ extern const GVecGen3 bit_op;
+@@ -XXX,XX +XXX,XX @@ const uint64_t pred_esz_masks[4] = {
- extern const GVecGen3 bif_op;
+  *** SVE Logical - Unpredicated Group
- extern const GVecGen2i ssra_op[4];
+  */
- extern const GVecGen2i usra_op[4];
-+extern const GVecGen2i sri_op[4];
+-static bool trans_AND_zzz(DisasContext *s, arg_rrr_esz *a)
 +extern const GVecGen2i sli_op[4];
  /*
   * Forward to the isar_feature_* tests given a DisasContext pointer.
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_two_reg_misc(DisasContext *s, uint32_t insn)
      }
  }
 -static void gen_shr8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 -{
--    uint64_t mask = dup_const(MO_8, 0xff >> shift);
+-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_and, a);
 -    TCGv_i64 t = tcg_temp_new_i64();
 -
 -    tcg_gen_shri_i64(t, a, shift);
 -    tcg_gen_andi_i64(t, t, mask);
 -    tcg_gen_andi_i64(d, d, ~mask);
 -    tcg_gen_or_i64(d, d, t);
 -    tcg_temp_free_i64(t);
 -}
 -
--static void gen_shr16_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+-static bool trans_ORR_zzz(DisasContext *s, arg_rrr_esz *a)
 -{
--    uint64_t mask = dup_const(MO_16, 0xffff >> shift);
+-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_or, a);
 -    TCGv_i64 t = tcg_temp_new_i64();
 -
 -    tcg_gen_shri_i64(t, a, shift);
 -    tcg_gen_andi_i64(t, t, mask);
 -    tcg_gen_andi_i64(d, d, ~mask);
 -    tcg_gen_or_i64(d, d, t);
 -    tcg_temp_free_i64(t);
 -}
 -
--static void gen_shr32_ins_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
+-static bool trans_EOR_zzz(DisasContext *s, arg_rrr_esz *a)
 -{
--    tcg_gen_shri_i32(a, a, shift);
+-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_xor, a);
 -    tcg_gen_deposit_i32(d, d, a, 0, 32 - shift);
 -}
 -
--static void gen_shr64_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+-static bool trans_BIC_zzz(DisasContext *s, arg_rrr_esz *a)
 -{
--    tcg_gen_shri_i64(a, a, shift);
+-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_andc, a);
--    tcg_gen_deposit_i64(d, d, a, 0, 64 - shift);
+-}
 +TRANS_FEAT(AND_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_and, a)
 +TRANS_FEAT(ORR_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_or, a)
 +TRANS_FEAT(EOR_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_xor, a)
 +TRANS_FEAT(BIC_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_andc, a)
  static void gen_xar8_i64(TCGv_i64 d, TCGv_i64 n, TCGv_i64 m, int64_t sh)
  {
@@ -XXX,XX +XXX,XX @@ static bool trans_NBSL(DisasContext *s, arg_rrrr_esz *a)
   *** SVE Integer Arithmetic - Unpredicated Group
   */
 -static bool trans_ADD_zzz(DisasContext *s, arg_rrr_esz *a)
 -{
 -    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_add, a);
 -}
 -
--static void gen_shr_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
+-static bool trans_SUB_zzz(DisasContext *s, arg_rrr_esz *a)
 -{
--    uint64_t mask = (2ull << ((8 << vece) - 1)) - 1;
+-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_sub, a);
 -    TCGv_vec t = tcg_temp_new_vec_matching(d);
 -    TCGv_vec m = tcg_temp_new_vec_matching(d);
 -
 -    tcg_gen_dupi_vec(vece, m, mask ^ (mask >> sh));
 -    tcg_gen_shri_vec(vece, t, a, sh);
 -    tcg_gen_and_vec(vece, d, d, m);
 -    tcg_gen_or_vec(vece, d, d, t);
 -
 -    tcg_temp_free_vec(t);
 -    tcg_temp_free_vec(m);
 -}
 -
- /* SSHR[RA]/USHR[RA] - Vector shift right (optional rounding/accumulate) */
+-static bool trans_SQADD_zzz(DisasContext *s, arg_rrr_esz *a)
  static void handle_vec_simd_shri(DisasContext *s, bool is_q, bool is_u,
                                   int immh, int immb, int opcode, int rn, int rd)
  {
 -    static const GVecGen2i sri_op[4] = {
 -        { .fni8 = gen_shr8_ins_i64,
 -          .fniv = gen_shr_ins_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_shri_vec,
 -          .vece = MO_8 },
 -        { .fni8 = gen_shr16_ins_i64,
 -          .fniv = gen_shr_ins_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_shri_vec,
 -          .vece = MO_16 },
 -        { .fni4 = gen_shr32_ins_i32,
 -          .fniv = gen_shr_ins_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_shri_vec,
 -          .vece = MO_32 },
 -        { .fni8 = gen_shr64_ins_i64,
 -          .fniv = gen_shr_ins_vec,
 -          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -          .load_dest = true,
 -          .opc = INDEX_op_shri_vec,
 -          .vece = MO_64 },
 -    };
 -
      int size = 32 - clz32(immh) - 1;
      int immhb = immh << 3 | immb;
      int shift = 2 * (8 << size) - immhb;
@@ -XXX,XX +XXX,XX @@ static void handle_vec_simd_shri(DisasContext *s, bool is_q, bool is_u,
      clear_vec_high(s, is_q, rd);
  }
 -static void gen_shl8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 -{
--    uint64_t mask = dup_const(MO_8, 0xff << shift);
+-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_ssadd, a);
 -    TCGv_i64 t = tcg_temp_new_i64();
 -
 -    tcg_gen_shli_i64(t, a, shift);
 -    tcg_gen_andi_i64(t, t, mask);
 -    tcg_gen_andi_i64(d, d, ~mask);
 -    tcg_gen_or_i64(d, d, t);
 -    tcg_temp_free_i64(t);
 -}
 -
--static void gen_shl16_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+-static bool trans_SQSUB_zzz(DisasContext *s, arg_rrr_esz *a)
 -{
--    uint64_t mask = dup_const(MO_16, 0xffff << shift);
+-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_sssub, a);
 -    TCGv_i64 t = tcg_temp_new_i64();
 -
 -    tcg_gen_shli_i64(t, a, shift);
 -    tcg_gen_andi_i64(t, t, mask);
 -    tcg_gen_andi_i64(d, d, ~mask);
 -    tcg_gen_or_i64(d, d, t);
 -    tcg_temp_free_i64(t);
 -}
 -
--static void gen_shl32_ins_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
+-static bool trans_UQADD_zzz(DisasContext *s, arg_rrr_esz *a)
 -{
--    tcg_gen_deposit_i32(d, d, a, shift, 32 - shift);
+-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_usadd, a);
 -}
 -
--static void gen_shl64_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+-static bool trans_UQSUB_zzz(DisasContext *s, arg_rrr_esz *a)
 -{
--    tcg_gen_deposit_i64(d, d, a, shift, 64 - shift);
+-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_ussub, a);
 -}
--
++TRANS_FEAT(ADD_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_add, a)
--static void gen_shl_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
++TRANS_FEAT(SUB_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_sub, a)
 +TRANS_FEAT(SQADD_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_ssadd, a)
 +TRANS_FEAT(SQSUB_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_sssub, a)
 +TRANS_FEAT(UQADD_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_usadd, a)
 +TRANS_FEAT(UQSUB_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_ussub, a)
  /*
   *** SVE Integer Arithmetic - Binary Predicated Group
@@ -XXX,XX +XXX,XX @@ static bool trans_MOVPRFX_z(DisasContext *s, arg_rpr_esz *a)
   * SVE2 Integer Multiply - Unpredicated
   */
 -static bool trans_MUL_zzz(DisasContext *s, arg_rrr_esz *a)
 -{
--    uint64_t mask = (1ull << sh) - 1;
+-    if (!dc_isar_feature(aa64_sve2, s)) {
--    TCGv_vec t = tcg_temp_new_vec_matching(d);
+-        return false;
--    TCGv_vec m = tcg_temp_new_vec_matching(d);
+-    }
--
+-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_mul, a);
 -    tcg_gen_dupi_vec(vece, m, mask);
 -    tcg_gen_shli_vec(vece, t, a, sh);
 -    tcg_gen_and_vec(vece, d, d, m);
 -    tcg_gen_or_vec(vece, d, d, t);
 -
 -    tcg_temp_free_vec(t);
 -    tcg_temp_free_vec(m);
 -}
--
++TRANS_FEAT(MUL_zzz, aa64_sve2, gen_gvec_fn_arg_zzz, tcg_gen_gvec_mul, a)
- /* SHL/SLI - Vector shift left */
- static void handle_vec_simd_shli(DisasContext *s, bool is_q, bool insert,
+ static gen_helper_gvec_3 * const smulh_zzz_fns[4] = {
-                                  int immh, int immb, int opcode, int rn, int rd)
+     gen_helper_gvec_smulh_b, gen_helper_gvec_smulh_h,
  {
 -    static const GVecGen2i shi_op[4] = {
 -        { .fni8 = gen_shl8_ins_i64,
 -          .fniv = gen_shl_ins_vec,
 -          .opc = INDEX_op_shli_vec,
 -          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -          .load_dest = true,
 -          .vece = MO_8 },
 -        { .fni8 = gen_shl16_ins_i64,
 -          .fniv = gen_shl_ins_vec,
 -          .opc = INDEX_op_shli_vec,
 -          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -          .load_dest = true,
 -          .vece = MO_16 },
 -        { .fni4 = gen_shl32_ins_i32,
 -          .fniv = gen_shl_ins_vec,
 -          .opc = INDEX_op_shli_vec,
 -          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -          .load_dest = true,
 -          .vece = MO_32 },
 -        { .fni8 = gen_shl64_ins_i64,
 -          .fniv = gen_shl_ins_vec,
 -          .opc = INDEX_op_shli_vec,
 -          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -          .load_dest = true,
 -          .vece = MO_64 },
 -    };
      int size = 32 - clz32(immh) - 1;
      int immhb = immh << 3 | immb;
      int shift = immhb - (8 << size);
@@ -XXX,XX +XXX,XX @@ static void handle_vec_simd_shli(DisasContext *s, bool is_q, bool insert,
      }
      if (insert) {
 -        gen_gvec_op2i(s, is_q, rd, rn, shift, &shi_op[size]);
 +        gen_gvec_op2i(s, is_q, rd, rn, shift, &sli_op[size]);
      } else {
          gen_gvec_fn2i(s, is_q, rd, rn, shift, tcg_gen_gvec_shli, size);
      }
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ const GVecGen2i usra_op[4] = {
        .vece = MO_64, },
  };
 +static void gen_shr8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    uint64_t mask = dup_const(MO_8, 0xff >> shift);
 +    TCGv_i64 t = tcg_temp_new_i64();
 +
 +    tcg_gen_shri_i64(t, a, shift);
 +    tcg_gen_andi_i64(t, t, mask);
 +    tcg_gen_andi_i64(d, d, ~mask);
 +    tcg_gen_or_i64(d, d, t);
 +    tcg_temp_free_i64(t);
 +}
 +
 +static void gen_shr16_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    uint64_t mask = dup_const(MO_16, 0xffff >> shift);
 +    TCGv_i64 t = tcg_temp_new_i64();
 +
 +    tcg_gen_shri_i64(t, a, shift);
 +    tcg_gen_andi_i64(t, t, mask);
 +    tcg_gen_andi_i64(d, d, ~mask);
 +    tcg_gen_or_i64(d, d, t);
 +    tcg_temp_free_i64(t);
 +}
 +
 +static void gen_shr32_ins_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
 +{
 +    tcg_gen_shri_i32(a, a, shift);
 +    tcg_gen_deposit_i32(d, d, a, 0, 32 - shift);
 +}
 +
 +static void gen_shr64_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    tcg_gen_shri_i64(a, a, shift);
 +    tcg_gen_deposit_i64(d, d, a, 0, 64 - shift);
 +}
 +
 +static void gen_shr_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
 +{
 +    if (sh == 0) {
 +        tcg_gen_mov_vec(d, a);
 +    } else {
 +        TCGv_vec t = tcg_temp_new_vec_matching(d);
 +        TCGv_vec m = tcg_temp_new_vec_matching(d);
 +
 +        tcg_gen_dupi_vec(vece, m, MAKE_64BIT_MASK((8 << vece) - sh, sh));
 +        tcg_gen_shri_vec(vece, t, a, sh);
 +        tcg_gen_and_vec(vece, d, d, m);
 +        tcg_gen_or_vec(vece, d, d, t);
 +
 +        tcg_temp_free_vec(t);
 +        tcg_temp_free_vec(m);
 +    }
 +}
 +
 +const GVecGen2i sri_op[4] = {
 +    { .fni8 = gen_shr8_ins_i64,
 +      .fniv = gen_shr_ins_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_shri_vec,
 +      .vece = MO_8 },
 +    { .fni8 = gen_shr16_ins_i64,
 +      .fniv = gen_shr_ins_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_shri_vec,
 +      .vece = MO_16 },
 +    { .fni4 = gen_shr32_ins_i32,
 +      .fniv = gen_shr_ins_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_shri_vec,
 +      .vece = MO_32 },
 +    { .fni8 = gen_shr64_ins_i64,
 +      .fniv = gen_shr_ins_vec,
 +      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 +      .load_dest = true,
 +      .opc = INDEX_op_shri_vec,
 +      .vece = MO_64 },
 +};
 +
 +static void gen_shl8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    uint64_t mask = dup_const(MO_8, 0xff << shift);
 +    TCGv_i64 t = tcg_temp_new_i64();
 +
 +    tcg_gen_shli_i64(t, a, shift);
 +    tcg_gen_andi_i64(t, t, mask);
 +    tcg_gen_andi_i64(d, d, ~mask);
 +    tcg_gen_or_i64(d, d, t);
 +    tcg_temp_free_i64(t);
 +}
 +
 +static void gen_shl16_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    uint64_t mask = dup_const(MO_16, 0xffff << shift);
 +    TCGv_i64 t = tcg_temp_new_i64();
 +
 +    tcg_gen_shli_i64(t, a, shift);
 +    tcg_gen_andi_i64(t, t, mask);
 +    tcg_gen_andi_i64(d, d, ~mask);
 +    tcg_gen_or_i64(d, d, t);
 +    tcg_temp_free_i64(t);
 +}
 +
 +static void gen_shl32_ins_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
 +{
 +    tcg_gen_deposit_i32(d, d, a, shift, 32 - shift);
 +}
 +
 +static void gen_shl64_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    tcg_gen_deposit_i64(d, d, a, shift, 64 - shift);
 +}
 +
 +static void gen_shl_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
 +{
 +    if (sh == 0) {
 +        tcg_gen_mov_vec(d, a);
 +    } else {
 +        TCGv_vec t = tcg_temp_new_vec_matching(d);
 +        TCGv_vec m = tcg_temp_new_vec_matching(d);
 +
 +        tcg_gen_dupi_vec(vece, m, MAKE_64BIT_MASK(0, sh));
 +        tcg_gen_shli_vec(vece, t, a, sh);
 +        tcg_gen_and_vec(vece, d, d, m);
 +        tcg_gen_or_vec(vece, d, d, t);
 +
 +        tcg_temp_free_vec(t);
 +        tcg_temp_free_vec(m);
 +    }
 +}
 +
 +const GVecGen2i sli_op[4] = {
 +    { .fni8 = gen_shl8_ins_i64,
 +      .fniv = gen_shl_ins_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_shli_vec,
 +      .vece = MO_8 },
 +    { .fni8 = gen_shl16_ins_i64,
 +      .fniv = gen_shl_ins_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_shli_vec,
 +      .vece = MO_16 },
 +    { .fni4 = gen_shl32_ins_i32,
 +      .fniv = gen_shl_ins_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_shli_vec,
 +      .vece = MO_32 },
 +    { .fni8 = gen_shl64_ins_i64,
 +      .fniv = gen_shl_ins_vec,
 +      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 +      .load_dest = true,
 +      .opc = INDEX_op_shli_vec,
 +      .vece = MO_64 },
 +};
 +
  /* Translate a NEON data processing instruction.  Return nonzero if the
     instruction is invalid.
     We process data in a mixture of 32-bit and 64-bit chunks.
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
      int pairwise;
      int u;
      int vec_size;
 -    uint32_t imm, mask;
 +    uint32_t imm;
      TCGv_i32 tmp, tmp2, tmp3, tmp4, tmp5;
      TCGv_ptr ptr1, ptr2, ptr3;
      TCGv_i64 tmp64;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                      }
                      return 0;
 +                case 4: /* VSRI */
 +                    if (!u) {
 +                        return 1;
 +                    }
 +                    /* Right shift comes here negative.  */
 +                    shift = -shift;
 +                    /* Shift out of range leaves destination unchanged.  */
 +                    if (shift < 8 << size) {
 +                        tcg_gen_gvec_2i(rd_ofs, rm_ofs, vec_size, vec_size,
 +                                        shift, &sri_op[size]);
 +                    }
 +                    return 0;
 +
                  case 5: /* VSHL, VSLI */
 -                    if (!u) { /* VSHL */
 +                    if (u) { /* VSLI */
 +                        /* Shift out of range leaves destination unchanged.  */
 +                        if (shift < 8 << size) {
 +                            tcg_gen_gvec_2i(rd_ofs, rm_ofs, vec_size,
 +                                            vec_size, shift, &sli_op[size]);
 +                        }
 +                    } else { /* VSHL */
                          /* Shifts larger than the element size are
                           * architecturally valid and results in zero.
                           */
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                              tcg_gen_gvec_shli(size, rd_ofs, rm_ofs, shift,
                                                vec_size, vec_size);
                          }
 -                        return 0;
                      }
 -                    break;
 +                    return 0;
                  }
                  if (size == 3) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                              else
                                  gen_helper_neon_rshl_s64(cpu_V0, cpu_V0, cpu_V1);
                              break;
 -                        case 4: /* VSRI */
 -                        case 5: /* VSHL, VSLI */
 -                            gen_helper_neon_shl_u64(cpu_V0, cpu_V0, cpu_V1);
 -                            break;
                          case 6: /* VQSHLU */
                              gen_helper_neon_qshlu_s64(cpu_V0, cpu_env,
                                                        cpu_V0, cpu_V1);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                              /* Accumulate.  */
                              neon_load_reg64(cpu_V1, rd + pass);
                              tcg_gen_add_i64(cpu_V0, cpu_V0, cpu_V1);
 -                        } else if (op == 4 || (op == 5 && u)) {
 -                            /* Insert */
 -                            neon_load_reg64(cpu_V1, rd + pass);
 -                            uint64_t mask;
 -                            if (shift < -63 || shift > 63) {
 -                                mask = 0;
 -                            } else {
 -                                if (op == 4) {
 -                                    mask = 0xffffffffffffffffull >> -shift;
 -                                } else {
 -                                    mask = 0xffffffffffffffffull << shift;
 -                                }
 -                            }
 -                            tcg_gen_andi_i64(cpu_V1, cpu_V1, ~mask);
 -                            tcg_gen_or_i64(cpu_V0, cpu_V0, cpu_V1);
                          }
                          neon_store_reg64(cpu_V0, rd + pass);
                      } else { /* size < 3 */
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                          case 3: /* VRSRA */
                              GEN_NEON_INTEGER_OP(rshl);
                              break;
 -                        case 4: /* VSRI */
 -                        case 5: /* VSHL, VSLI */
 -                            switch (size) {
 -                            case 0: gen_helper_neon_shl_u8(tmp, tmp, tmp2); break;
 -                            case 1: gen_helper_neon_shl_u16(tmp, tmp, tmp2); break;
 -                            case 2: gen_helper_neon_shl_u32(tmp, tmp, tmp2); break;
 -                            default: abort();
 -                            }
 -                            break;
                          case 6: /* VQSHLU */
                              switch (size) {
                              case 0:
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                              tmp2 = neon_load_reg(rd, pass);
                              gen_neon_add(size, tmp, tmp2);
                              tcg_temp_free_i32(tmp2);
 -                        } else if (op == 4 || (op == 5 && u)) {
 -                            /* Insert */
 -                            switch (size) {
 -                            case 0:
 -                                if (op == 4)
 -                                    mask = 0xff >> -shift;
 -                                else
 -                                    mask = (uint8_t)(0xff << shift);
 -                                mask |= mask << 8;
 -                                mask |= mask << 16;
 -                                break;
 -                            case 1:
 -                                if (op == 4)
 -                                    mask = 0xffff >> -shift;
 -                                else
 -                                    mask = (uint16_t)(0xffff << shift);
 -                                mask |= mask << 16;
 -                                break;
 -                            case 2:
 -                                if (shift < -31 || shift > 31) {
 -                                    mask = 0;
 -                                } else {
 -                                    if (op == 4)
 -                                        mask = 0xffffffffu >> -shift;
 -                                    else
 -                                        mask = 0xffffffffu << shift;
 -                                }
 -                                break;
 -                            default:
 -                                abort();
 -                            }
 -                            tmp2 = neon_load_reg(rd, pass);
 -                            tcg_gen_andi_i32(tmp, tmp, mask);
 -                            tcg_gen_andi_i32(tmp2, tmp2, ~mask);
 -                            tcg_gen_or_i32(tmp, tmp, tmp2);
 -                            tcg_temp_free_i32(tmp2);
                          }
                          neon_store_reg(rd, pass, tmp);
                      }
 --
-.19.1
+.25.1

-New patch
+[PULL 037/117] target/arm: Use TRANS_FEAT for do_sve2_fn_zzz
+From: Richard Henderson <richard.henderson@linaro.org>
+Convert SVE translation functions using do_sve2_fn_zzz
+to use TRANS_FEAT and gen_gvec_fn_arg_zzz.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-35-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 19 ++-----------------
+file changed, 2 insertions(+), 17 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool trans_SLI(DisasContext *s, arg_rri_esz *a)
+     return do_sve2_fn2i(s, a, gen_gvec_sli);
+ }
+-static bool do_sve2_fn_zzz(DisasContext *s, arg_rrr_esz *a, GVecGen3Fn *fn)
+-{
+-    if (!dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    return gen_gvec_fn_arg_zzz(s, fn, a);
+-}
+-
+-static bool trans_SABA(DisasContext *s, arg_rrr_esz *a)
+-{
+-    return do_sve2_fn_zzz(s, a, gen_gvec_saba);
+-}
+-
+-static bool trans_UABA(DisasContext *s, arg_rrr_esz *a)
+-{
+-    return do_sve2_fn_zzz(s, a, gen_gvec_uaba);
+-}
++TRANS_FEAT(SABA, aa64_sve2, gen_gvec_fn_arg_zzz, gen_gvec_saba, a)
++TRANS_FEAT(UABA, aa64_sve2, gen_gvec_fn_arg_zzz, gen_gvec_uaba, a)
+ static bool do_sve2_narrow_extract(DisasContext *s, arg_rri_esz *a,
+                                    const GVecGen2 ops[3])
+--
+.25.1

-New patch
+[PULL 038/117] target/arm: Use TRANS_FEAT for RAX1
+From: Richard Henderson <richard.henderson@linaro.org>
+The decode for RAX1 sets esz to MO_8, because that's what
+we use by default for "no esz present".  We changed that
+to MO_64 during translation because it is more logical for
+the operation.  However, the esz argument to gen_gvec_rax1
+is unused and forces MO_64 within that function, so there
+is no need to do it here as well.
+Simplify to use gen_gvec_fn_arg_zzz and TRANS_FEAT.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-36-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 8 +-------
+file changed, 1 insertion(+), 7 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(SM4E, aa64_sve2_sm4, gen_gvec_ool_arg_zzz,
+ TRANS_FEAT(SM4EKEY, aa64_sve2_sm4, gen_gvec_ool_arg_zzz,
+            gen_helper_crypto_sm4ekey, a, 0)
+-static bool trans_RAX1(DisasContext *s, arg_rrr_esz *a)
+-{
+-    if (!dc_isar_feature(aa64_sve2_sha3, s)) {
+-        return false;
+-    }
+-    return gen_gvec_fn_zzz(s, gen_gvec_rax1, MO_64, a->rd, a->rn, a->rm);
+-}
++TRANS_FEAT(RAX1, aa64_sve2_sha3, gen_gvec_fn_arg_zzz, gen_gvec_rax1, a)
+ static bool trans_FCVTNT_sh(DisasContext *s, arg_rpr_esz *a)
+ {
+--
+.25.1

-New patch
+[PULL 039/117] target/arm: Introduce gen_gvec_fn_arg_zzzz
+From: Richard Henderson <richard.henderson@linaro.org>
+Merge gen_gvec_fn_zzzz with the sve access check and the
+dereference of arg_rrrr_esz.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-37-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 25 ++++++++++++++-----------
+file changed, 14 insertions(+), 11 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_fn_arg_zzz(DisasContext *s, GVecGen3Fn *fn,
+ }
+ /* Invoke a vector expander on four Zregs.  */
+-static void gen_gvec_fn_zzzz(DisasContext *s, GVecGen4Fn *gvec_fn,
+-                             int esz, int rd, int rn, int rm, int ra)
++static bool gen_gvec_fn_arg_zzzz(DisasContext *s, GVecGen4Fn *gvec_fn,
++                                 arg_rrrr_esz *a)
+ {
+-    unsigned vsz = vec_full_reg_size(s);
+-    gvec_fn(esz, vec_full_reg_offset(s, rd),
+-            vec_full_reg_offset(s, rn),
+-            vec_full_reg_offset(s, rm),
+-            vec_full_reg_offset(s, ra), vsz, vsz);
++    if (gvec_fn == NULL) {
++        return false;
++    }
++    if (sve_access_check(s)) {
++        unsigned vsz = vec_full_reg_size(s);
++        gvec_fn(a->esz, vec_full_reg_offset(s, a->rd),
++                vec_full_reg_offset(s, a->rn),
++                vec_full_reg_offset(s, a->rm),
++                vec_full_reg_offset(s, a->ra), vsz, vsz);
++    }
++    return true;
+ }
+ /* Invoke a vector move on two Zregs.  */
+@@ -XXX,XX +XXX,XX @@ static bool do_sve2_zzzz_fn(DisasContext *s, arg_rrrr_esz *a, GVecGen4Fn *fn)
+     if (!dc_isar_feature(aa64_sve2, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        gen_gvec_fn_zzzz(s, fn, a->esz, a->rd, a->rn, a->rm, a->ra);
+-    }
+-    return true;
++    return gen_gvec_fn_arg_zzzz(s, fn, a);
+ }
+ static void gen_eor3_i64(TCGv_i64 d, TCGv_i64 n, TCGv_i64 m, TCGv_i64 k)
+--
+.25.1

-[Qemu-devel] [PULL 03/45] target/arm: Move some system registers into a substructure
+[PULL 040/117] target/arm: Use TRANS_FEAT for do_sve2_zzzz_fn
 From: Richard Henderson <richard.henderson@linaro.org>
-Create struct ARMISARegisters, to be accessed during translation.
+Convert SVE translation functions using do_sve2_zzzz_fn
 to use TRANS_FEAT and gen_gvec_fn_arg_zzzz.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181016223115.24100-2-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-38-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.h      |  32 ++++----
+ target/arm/translate-sve.c | 38 ++++++--------------------------------
- hw/intc/armv7m_nvic.c |  12 +--
+file changed, 6 insertions(+), 32 deletions(-)
  target/arm/cpu.c      | 178 +++++++++++++++++++++---------------------
  target/arm/cpu64.c    |  70 ++++++++---------
  target/arm/helper.c   |  28 +++----
 files changed, 162 insertions(+), 158 deletions(-)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/cpu.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ struct ARMCPU {
+@@ -XXX,XX +XXX,XX @@ static bool trans_XAR(DisasContext *s, arg_rrri_esz *a)
-      * ARMv7AR ARM Architecture Reference Manual. A reset_ prefix
+     return true;
       * is used for reset values of non-constant registers; no reset_
       * prefix means a constant register.
 +     * Some of these registers are split out into a substructure that
 +     * is shared with the translators to control the ISA.
       */
 +    struct ARMISARegisters {
 +        uint32_t id_isar0;
 +        uint32_t id_isar1;
 +        uint32_t id_isar2;
 +        uint32_t id_isar3;
 +        uint32_t id_isar4;
 +        uint32_t id_isar5;
 +        uint32_t id_isar6;
 +        uint32_t mvfr0;
 +        uint32_t mvfr1;
 +        uint32_t mvfr2;
 +        uint64_t id_aa64isar0;
 +        uint64_t id_aa64isar1;
 +        uint64_t id_aa64pfr0;
 +        uint64_t id_aa64pfr1;
 +    } isar;
      uint32_t midr;
      uint32_t revidr;
      uint32_t reset_fpsid;
 -    uint32_t mvfr0;
 -    uint32_t mvfr1;
 -    uint32_t mvfr2;
      uint32_t ctr;
      uint32_t reset_sctlr;
      uint32_t id_pfr0;
@@ -XXX,XX +XXX,XX @@ struct ARMCPU {
      uint32_t id_mmfr2;
      uint32_t id_mmfr3;
      uint32_t id_mmfr4;
 -    uint32_t id_isar0;
 -    uint32_t id_isar1;
 -    uint32_t id_isar2;
 -    uint32_t id_isar3;
 -    uint32_t id_isar4;
 -    uint32_t id_isar5;
 -    uint32_t id_isar6;
 -    uint64_t id_aa64pfr0;
 -    uint64_t id_aa64pfr1;
      uint64_t id_aa64dfr0;
      uint64_t id_aa64dfr1;
      uint64_t id_aa64afr0;
      uint64_t id_aa64afr1;
 -    uint64_t id_aa64isar0;
 -    uint64_t id_aa64isar1;
      uint64_t id_aa64mmfr0;
      uint64_t id_aa64mmfr1;
      uint32_t dbgdidr;
 diff --git a/hw/intc/armv7m_nvic.c b/hw/intc/armv7m_nvic.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/intc/armv7m_nvic.c
 +++ b/hw/intc/armv7m_nvic.c
@@ -XXX,XX +XXX,XX @@ static uint32_t nvic_readl(NVICState *s, uint32_t offset, MemTxAttrs attrs)
      case 0xd5c: /* MMFR3.  */
          return cpu->id_mmfr3;
      case 0xd60: /* ISAR0.  */
 -        return cpu->id_isar0;
 +        return cpu->isar.id_isar0;
      case 0xd64: /* ISAR1.  */
 -        return cpu->id_isar1;
 +        return cpu->isar.id_isar1;
      case 0xd68: /* ISAR2.  */
 -        return cpu->id_isar2;
 +        return cpu->isar.id_isar2;
      case 0xd6c: /* ISAR3.  */
 -        return cpu->id_isar3;
 +        return cpu->isar.id_isar3;
      case 0xd70: /* ISAR4.  */
 -        return cpu->id_isar4;
 +        return cpu->isar.id_isar4;
      case 0xd74: /* ISAR5.  */
 -        return cpu->id_isar5;
 +        return cpu->isar.id_isar5;
      case 0xd78: /* CLIDR */
          return cpu->clidr;
      case 0xd7c: /* CTR */
 diff --git a/target/arm/cpu.c b/target/arm/cpu.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu.c
 +++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_reset(CPUState *s)
      g_hash_table_foreach(cpu->cp_regs, cp_reg_check_reset, cpu);
      env->vfp.xregs[ARM_VFP_FPSID] = cpu->reset_fpsid;
 -    env->vfp.xregs[ARM_VFP_MVFR0] = cpu->mvfr0;
 -    env->vfp.xregs[ARM_VFP_MVFR1] = cpu->mvfr1;
 -    env->vfp.xregs[ARM_VFP_MVFR2] = cpu->mvfr2;
 +    env->vfp.xregs[ARM_VFP_MVFR0] = cpu->isar.mvfr0;
 +    env->vfp.xregs[ARM_VFP_MVFR1] = cpu->isar.mvfr1;
 +    env->vfp.xregs[ARM_VFP_MVFR2] = cpu->isar.mvfr2;
      cpu->power_state = cpu->start_powered_off ? PSCI_OFF : PSCI_ON;
      s->halted = cpu->start_powered_off;
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
           * registers as well. These are id_pfr1[7:4] and id_aa64pfr0[15:12].
           */
          cpu->id_pfr1 &= ~0xf0;
 -        cpu->id_aa64pfr0 &= ~0xf000;
 +        cpu->isar.id_aa64pfr0 &= ~0xf000;
      }
      if (!cpu->has_el2) {
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
           * registers if we don't have EL2. These are id_pfr1[15:12] and
           * id_aa64pfr0_el1[11:8].
           */
 -        cpu->id_aa64pfr0 &= ~0xf00;
 +        cpu->isar.id_aa64pfr0 &= ~0xf00;
          cpu->id_pfr1 &= ~0xf000;
      }
@@ -XXX,XX +XXX,XX @@ static void arm1136_r2_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_CACHE_BLOCK_OPS);
      cpu->midr = 0x4107b362;
      cpu->reset_fpsid = 0x410120b4;
 -    cpu->mvfr0 = 0x11111111;
 -    cpu->mvfr1 = 0x00000000;
 +    cpu->isar.mvfr0 = 0x11111111;
 +    cpu->isar.mvfr1 = 0x00000000;
      cpu->ctr = 0x1dd20d2;
      cpu->reset_sctlr = 0x00050078;
      cpu->id_pfr0 = 0x111;
@@ -XXX,XX +XXX,XX @@ static void arm1136_r2_initfn(Object *obj)
      cpu->id_mmfr0 = 0x01130003;
      cpu->id_mmfr1 = 0x10030302;
      cpu->id_mmfr2 = 0x01222110;
 -    cpu->id_isar0 = 0x00140011;
 -    cpu->id_isar1 = 0x12002111;
 -    cpu->id_isar2 = 0x11231111;
 -    cpu->id_isar3 = 0x01102131;
 -    cpu->id_isar4 = 0x141;
 +    cpu->isar.id_isar0 = 0x00140011;
 +    cpu->isar.id_isar1 = 0x12002111;
 +    cpu->isar.id_isar2 = 0x11231111;
 +    cpu->isar.id_isar3 = 0x01102131;
 +    cpu->isar.id_isar4 = 0x141;
      cpu->reset_auxcr = 7;
  }
-@@ -XXX,XX +XXX,XX @@ static void arm1136_initfn(Object *obj)
+-static bool do_sve2_zzzz_fn(DisasContext *s, arg_rrrr_esz *a, GVecGen4Fn *fn)
-     set_feature(&cpu->env, ARM_FEATURE_CACHE_BLOCK_OPS);
+-{
-     cpu->midr = 0x4117b363;
+-    if (!dc_isar_feature(aa64_sve2, s)) {
-     cpu->reset_fpsid = 0x410120b4;
+-        return false;
--    cpu->mvfr0 = 0x11111111;
+-    }
--    cpu->mvfr1 = 0x00000000;
+-    return gen_gvec_fn_arg_zzzz(s, fn, a);
-+    cpu->isar.mvfr0 = 0x11111111;
+-}
-+    cpu->isar.mvfr1 = 0x00000000;
+-
-     cpu->ctr = 0x1dd20d2;
+ static void gen_eor3_i64(TCGv_i64 d, TCGv_i64 n, TCGv_i64 m, TCGv_i64 k)
-     cpu->reset_sctlr = 0x00050078;
+ {
-     cpu->id_pfr0 = 0x111;
+     tcg_gen_xor_i64(d, n, m);
-@@ -XXX,XX +XXX,XX @@ static void arm1136_initfn(Object *obj)
+@@ -XXX,XX +XXX,XX @@ static void gen_eor3(unsigned vece, uint32_t d, uint32_t n, uint32_t m,
-     cpu->id_mmfr0 = 0x01130003;
+     tcg_gen_gvec_4(d, n, m, a, oprsz, maxsz, &op);
      cpu->id_mmfr1 = 0x10030302;
      cpu->id_mmfr2 = 0x01222110;
 -    cpu->id_isar0 = 0x00140011;
 -    cpu->id_isar1 = 0x12002111;
 -    cpu->id_isar2 = 0x11231111;
 -    cpu->id_isar3 = 0x01102131;
 -    cpu->id_isar4 = 0x141;
 +    cpu->isar.id_isar0 = 0x00140011;
 +    cpu->isar.id_isar1 = 0x12002111;
 +    cpu->isar.id_isar2 = 0x11231111;
 +    cpu->isar.id_isar3 = 0x01102131;
 +    cpu->isar.id_isar4 = 0x141;
      cpu->reset_auxcr = 7;
  }
-@@ -XXX,XX +XXX,XX @@ static void arm1176_initfn(Object *obj)
+-static bool trans_EOR3(DisasContext *s, arg_rrrr_esz *a)
-     set_feature(&cpu->env, ARM_FEATURE_EL3);
+-{
-     cpu->midr = 0x410fb767;
+-    return do_sve2_zzzz_fn(s, a, gen_eor3);
-     cpu->reset_fpsid = 0x410120b5;
+-}
--    cpu->mvfr0 = 0x11111111;
++TRANS_FEAT(EOR3, aa64_sve2, gen_gvec_fn_arg_zzzz, gen_eor3, a)
--    cpu->mvfr1 = 0x00000000;
-+    cpu->isar.mvfr0 = 0x11111111;
+ static void gen_bcax_i64(TCGv_i64 d, TCGv_i64 n, TCGv_i64 m, TCGv_i64 k)
-+    cpu->isar.mvfr1 = 0x00000000;
+ {
-     cpu->ctr = 0x1dd20d2;
+@@ -XXX,XX +XXX,XX @@ static void gen_bcax(unsigned vece, uint32_t d, uint32_t n, uint32_t m,
-     cpu->reset_sctlr = 0x00050078;
+     tcg_gen_gvec_4(d, n, m, a, oprsz, maxsz, &op);
      cpu->id_pfr0 = 0x111;
@@ -XXX,XX +XXX,XX @@ static void arm1176_initfn(Object *obj)
      cpu->id_mmfr0 = 0x01130003;
      cpu->id_mmfr1 = 0x10030302;
      cpu->id_mmfr2 = 0x01222100;
 -    cpu->id_isar0 = 0x0140011;
 -    cpu->id_isar1 = 0x12002111;
 -    cpu->id_isar2 = 0x11231121;
 -    cpu->id_isar3 = 0x01102131;
 -    cpu->id_isar4 = 0x01141;
 +    cpu->isar.id_isar0 = 0x0140011;
 +    cpu->isar.id_isar1 = 0x12002111;
 +    cpu->isar.id_isar2 = 0x11231121;
 +    cpu->isar.id_isar3 = 0x01102131;
 +    cpu->isar.id_isar4 = 0x01141;
      cpu->reset_auxcr = 7;
  }
-@@ -XXX,XX +XXX,XX @@ static void arm11mpcore_initfn(Object *obj)
+-static bool trans_BCAX(DisasContext *s, arg_rrrr_esz *a)
-     set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
+-{
-     cpu->midr = 0x410fb022;
+-    return do_sve2_zzzz_fn(s, a, gen_bcax);
-     cpu->reset_fpsid = 0x410120b4;
+-}
--    cpu->mvfr0 = 0x11111111;
++TRANS_FEAT(BCAX, aa64_sve2, gen_gvec_fn_arg_zzzz, gen_bcax, a)
--    cpu->mvfr1 = 0x00000000;
-+    cpu->isar.mvfr0 = 0x11111111;
+ static void gen_bsl(unsigned vece, uint32_t d, uint32_t n, uint32_t m,
-+    cpu->isar.mvfr1 = 0x00000000;
+                     uint32_t a, uint32_t oprsz, uint32_t maxsz)
-     cpu->ctr = 0x1d192992; /* 32K icache 32K dcache */
+@@ -XXX,XX +XXX,XX @@ static void gen_bsl(unsigned vece, uint32_t d, uint32_t n, uint32_t m,
-     cpu->id_pfr0 = 0x111;
+     tcg_gen_gvec_bitsel(vece, d, a, n, m, oprsz, maxsz);
      cpu->id_pfr1 = 0x1;
@@ -XXX,XX +XXX,XX @@ static void arm11mpcore_initfn(Object *obj)
      cpu->id_mmfr0 = 0x01100103;
      cpu->id_mmfr1 = 0x10020302;
      cpu->id_mmfr2 = 0x01222000;
 -    cpu->id_isar0 = 0x00100011;
 -    cpu->id_isar1 = 0x12002111;
 -    cpu->id_isar2 = 0x11221011;
 -    cpu->id_isar3 = 0x01102131;
 -    cpu->id_isar4 = 0x141;
 +    cpu->isar.id_isar0 = 0x00100011;
 +    cpu->isar.id_isar1 = 0x12002111;
 +    cpu->isar.id_isar2 = 0x11221011;
 +    cpu->isar.id_isar3 = 0x01102131;
 +    cpu->isar.id_isar4 = 0x141;
      cpu->reset_auxcr = 1;
  }
-@@ -XXX,XX +XXX,XX @@ static void cortex_m3_initfn(Object *obj)
+-static bool trans_BSL(DisasContext *s, arg_rrrr_esz *a)
-     cpu->id_mmfr1 = 0x00000000;
+-{
-     cpu->id_mmfr2 = 0x00000000;
+-    return do_sve2_zzzz_fn(s, a, gen_bsl);
-     cpu->id_mmfr3 = 0x00000000;
+-}
--    cpu->id_isar0 = 0x01141110;
++TRANS_FEAT(BSL, aa64_sve2, gen_gvec_fn_arg_zzzz, gen_bsl, a)
--    cpu->id_isar1 = 0x02111000;
--    cpu->id_isar2 = 0x21112231;
+ static void gen_bsl1n_i64(TCGv_i64 d, TCGv_i64 n, TCGv_i64 m, TCGv_i64 k)
--    cpu->id_isar3 = 0x01111110;
+ {
--    cpu->id_isar4 = 0x01310102;
+@@ -XXX,XX +XXX,XX @@ static void gen_bsl1n(unsigned vece, uint32_t d, uint32_t n, uint32_t m,
--    cpu->id_isar5 = 0x00000000;
+     tcg_gen_gvec_4(d, n, m, a, oprsz, maxsz, &op);
 -    cpu->id_isar6 = 0x00000000;
 +    cpu->isar.id_isar0 = 0x01141110;
 +    cpu->isar.id_isar1 = 0x02111000;
 +    cpu->isar.id_isar2 = 0x21112231;
 +    cpu->isar.id_isar3 = 0x01111110;
 +    cpu->isar.id_isar4 = 0x01310102;
 +    cpu->isar.id_isar5 = 0x00000000;
 +    cpu->isar.id_isar6 = 0x00000000;
  }
- static void cortex_m4_initfn(Object *obj)
+-static bool trans_BSL1N(DisasContext *s, arg_rrrr_esz *a)
-@@ -XXX,XX +XXX,XX @@ static void cortex_m4_initfn(Object *obj)
+-{
-     cpu->id_mmfr1 = 0x00000000;
+-    return do_sve2_zzzz_fn(s, a, gen_bsl1n);
-     cpu->id_mmfr2 = 0x00000000;
+-}
-     cpu->id_mmfr3 = 0x00000000;
++TRANS_FEAT(BSL1N, aa64_sve2, gen_gvec_fn_arg_zzzz, gen_bsl1n, a)
--    cpu->id_isar0 = 0x01141110;
--    cpu->id_isar1 = 0x02111000;
+ static void gen_bsl2n_i64(TCGv_i64 d, TCGv_i64 n, TCGv_i64 m, TCGv_i64 k)
--    cpu->id_isar2 = 0x21112231;
+ {
--    cpu->id_isar3 = 0x01111110;
+@@ -XXX,XX +XXX,XX @@ static void gen_bsl2n(unsigned vece, uint32_t d, uint32_t n, uint32_t m,
--    cpu->id_isar4 = 0x01310102;
+     tcg_gen_gvec_4(d, n, m, a, oprsz, maxsz, &op);
 -    cpu->id_isar5 = 0x00000000;
 -    cpu->id_isar6 = 0x00000000;
 +    cpu->isar.id_isar0 = 0x01141110;
 +    cpu->isar.id_isar1 = 0x02111000;
 +    cpu->isar.id_isar2 = 0x21112231;
 +    cpu->isar.id_isar3 = 0x01111110;
 +    cpu->isar.id_isar4 = 0x01310102;
 +    cpu->isar.id_isar5 = 0x00000000;
 +    cpu->isar.id_isar6 = 0x00000000;
  }
- static void cortex_m33_initfn(Object *obj)
+-static bool trans_BSL2N(DisasContext *s, arg_rrrr_esz *a)
-@@ -XXX,XX +XXX,XX @@ static void cortex_m33_initfn(Object *obj)
+-{
-     cpu->id_mmfr1 = 0x00000000;
+-    return do_sve2_zzzz_fn(s, a, gen_bsl2n);
-     cpu->id_mmfr2 = 0x01000000;
+-}
-     cpu->id_mmfr3 = 0x00000000;
++TRANS_FEAT(BSL2N, aa64_sve2, gen_gvec_fn_arg_zzzz, gen_bsl2n, a)
--    cpu->id_isar0 = 0x01101110;
--    cpu->id_isar1 = 0x02212000;
+ static void gen_nbsl_i64(TCGv_i64 d, TCGv_i64 n, TCGv_i64 m, TCGv_i64 k)
--    cpu->id_isar2 = 0x20232232;
+ {
--    cpu->id_isar3 = 0x01111131;
+@@ -XXX,XX +XXX,XX @@ static void gen_nbsl(unsigned vece, uint32_t d, uint32_t n, uint32_t m,
--    cpu->id_isar4 = 0x01310132;
+     tcg_gen_gvec_4(d, n, m, a, oprsz, maxsz, &op);
 -    cpu->id_isar5 = 0x00000000;
 -    cpu->id_isar6 = 0x00000000;
 +    cpu->isar.id_isar0 = 0x01101110;
 +    cpu->isar.id_isar1 = 0x02212000;
 +    cpu->isar.id_isar2 = 0x20232232;
 +    cpu->isar.id_isar3 = 0x01111131;
 +    cpu->isar.id_isar4 = 0x01310132;
 +    cpu->isar.id_isar5 = 0x00000000;
 +    cpu->isar.id_isar6 = 0x00000000;
      cpu->clidr = 0x00000000;
      cpu->ctr = 0x8000c000;
  }
-@@ -XXX,XX +XXX,XX @@ static void cortex_r5_initfn(Object *obj)
-     cpu->id_mmfr1 = 0x00000000;
+-static bool trans_NBSL(DisasContext *s, arg_rrrr_esz *a)
-     cpu->id_mmfr2 = 0x01200000;
+-{
-     cpu->id_mmfr3 = 0x0211;
+-    return do_sve2_zzzz_fn(s, a, gen_nbsl);
--    cpu->id_isar0 = 0x02101111;
+-}
--    cpu->id_isar1 = 0x13112111;
++TRANS_FEAT(NBSL, aa64_sve2, gen_gvec_fn_arg_zzzz, gen_nbsl, a)
--    cpu->id_isar2 = 0x21232141;
--    cpu->id_isar3 = 0x01112131;
+ /*
--    cpu->id_isar4 = 0x0010142;
+  *** SVE Integer Arithmetic - Unpredicated Group
 -    cpu->id_isar5 = 0x0;
 -    cpu->id_isar6 = 0x0;
 +    cpu->isar.id_isar0 = 0x02101111;
 +    cpu->isar.id_isar1 = 0x13112111;
 +    cpu->isar.id_isar2 = 0x21232141;
 +    cpu->isar.id_isar3 = 0x01112131;
 +    cpu->isar.id_isar4 = 0x0010142;
 +    cpu->isar.id_isar5 = 0x0;
 +    cpu->isar.id_isar6 = 0x0;
      cpu->mp_is_up = true;
      cpu->pmsav7_dregion = 16;
      define_arm_cp_regs(cpu, cortexr5_cp_reginfo);
@@ -XXX,XX +XXX,XX @@ static void cortex_a8_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_EL3);
      cpu->midr = 0x410fc080;
      cpu->reset_fpsid = 0x410330c0;
 -    cpu->mvfr0 = 0x11110222;
 -    cpu->mvfr1 = 0x00011111;
 +    cpu->isar.mvfr0 = 0x11110222;
 +    cpu->isar.mvfr1 = 0x00011111;
      cpu->ctr = 0x82048004;
      cpu->reset_sctlr = 0x00c50078;
      cpu->id_pfr0 = 0x1031;
@@ -XXX,XX +XXX,XX @@ static void cortex_a8_initfn(Object *obj)
      cpu->id_mmfr1 = 0x20000000;
      cpu->id_mmfr2 = 0x01202000;
      cpu->id_mmfr3 = 0x11;
 -    cpu->id_isar0 = 0x00101111;
 -    cpu->id_isar1 = 0x12112111;
 -    cpu->id_isar2 = 0x21232031;
 -    cpu->id_isar3 = 0x11112131;
 -    cpu->id_isar4 = 0x00111142;
 +    cpu->isar.id_isar0 = 0x00101111;
 +    cpu->isar.id_isar1 = 0x12112111;
 +    cpu->isar.id_isar2 = 0x21232031;
 +    cpu->isar.id_isar3 = 0x11112131;
 +    cpu->isar.id_isar4 = 0x00111142;
      cpu->dbgdidr = 0x15141000;
      cpu->clidr = (1 << 27) | (2 << 24) | 3;
      cpu->ccsidr[0] = 0xe007e01a; /* 16k L1 dcache. */
@@ -XXX,XX +XXX,XX @@ static void cortex_a9_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_CBAR);
      cpu->midr = 0x410fc090;
      cpu->reset_fpsid = 0x41033090;
 -    cpu->mvfr0 = 0x11110222;
 -    cpu->mvfr1 = 0x01111111;
 +    cpu->isar.mvfr0 = 0x11110222;
 +    cpu->isar.mvfr1 = 0x01111111;
      cpu->ctr = 0x80038003;
      cpu->reset_sctlr = 0x00c50078;
      cpu->id_pfr0 = 0x1031;
@@ -XXX,XX +XXX,XX @@ static void cortex_a9_initfn(Object *obj)
      cpu->id_mmfr1 = 0x20000000;
      cpu->id_mmfr2 = 0x01230000;
      cpu->id_mmfr3 = 0x00002111;
 -    cpu->id_isar0 = 0x00101111;
 -    cpu->id_isar1 = 0x13112111;
 -    cpu->id_isar2 = 0x21232041;
 -    cpu->id_isar3 = 0x11112131;
 -    cpu->id_isar4 = 0x00111142;
 +    cpu->isar.id_isar0 = 0x00101111;
 +    cpu->isar.id_isar1 = 0x13112111;
 +    cpu->isar.id_isar2 = 0x21232041;
 +    cpu->isar.id_isar3 = 0x11112131;
 +    cpu->isar.id_isar4 = 0x00111142;
      cpu->dbgdidr = 0x35141000;
      cpu->clidr = (1 << 27) | (1 << 24) | 3;
      cpu->ccsidr[0] = 0xe00fe019; /* 16k L1 dcache. */
@@ -XXX,XX +XXX,XX @@ static void cortex_a7_initfn(Object *obj)
      cpu->kvm_target = QEMU_KVM_ARM_TARGET_CORTEX_A7;
      cpu->midr = 0x410fc075;
      cpu->reset_fpsid = 0x41023075;
 -    cpu->mvfr0 = 0x10110222;
 -    cpu->mvfr1 = 0x11111111;
 +    cpu->isar.mvfr0 = 0x10110222;
 +    cpu->isar.mvfr1 = 0x11111111;
      cpu->ctr = 0x84448003;
      cpu->reset_sctlr = 0x00c50078;
      cpu->id_pfr0 = 0x00001131;
@@ -XXX,XX +XXX,XX @@ static void cortex_a7_initfn(Object *obj)
      /* a7_mpcore_r0p5_trm, page 4-4 gives 0x01101110; but
       * table 4-41 gives 0x02101110, which includes the arm div insns.
       */
 -    cpu->id_isar0 = 0x02101110;
 -    cpu->id_isar1 = 0x13112111;
 -    cpu->id_isar2 = 0x21232041;
 -    cpu->id_isar3 = 0x11112131;
 -    cpu->id_isar4 = 0x10011142;
 +    cpu->isar.id_isar0 = 0x02101110;
 +    cpu->isar.id_isar1 = 0x13112111;
 +    cpu->isar.id_isar2 = 0x21232041;
 +    cpu->isar.id_isar3 = 0x11112131;
 +    cpu->isar.id_isar4 = 0x10011142;
      cpu->dbgdidr = 0x3515f005;
      cpu->clidr = 0x0a200023;
      cpu->ccsidr[0] = 0x701fe00a; /* 32K L1 dcache */
@@ -XXX,XX +XXX,XX @@ static void cortex_a15_initfn(Object *obj)
      cpu->kvm_target = QEMU_KVM_ARM_TARGET_CORTEX_A15;
      cpu->midr = 0x412fc0f1;
      cpu->reset_fpsid = 0x410430f0;
 -    cpu->mvfr0 = 0x10110222;
 -    cpu->mvfr1 = 0x11111111;
 +    cpu->isar.mvfr0 = 0x10110222;
 +    cpu->isar.mvfr1 = 0x11111111;
      cpu->ctr = 0x8444c004;
      cpu->reset_sctlr = 0x00c50078;
      cpu->id_pfr0 = 0x00001131;
@@ -XXX,XX +XXX,XX @@ static void cortex_a15_initfn(Object *obj)
      cpu->id_mmfr1 = 0x20000000;
      cpu->id_mmfr2 = 0x01240000;
      cpu->id_mmfr3 = 0x02102211;
 -    cpu->id_isar0 = 0x02101110;
 -    cpu->id_isar1 = 0x13112111;
 -    cpu->id_isar2 = 0x21232041;
 -    cpu->id_isar3 = 0x11112131;
 -    cpu->id_isar4 = 0x10011142;
 +    cpu->isar.id_isar0 = 0x02101110;
 +    cpu->isar.id_isar1 = 0x13112111;
 +    cpu->isar.id_isar2 = 0x21232041;
 +    cpu->isar.id_isar3 = 0x11112131;
 +    cpu->isar.id_isar4 = 0x10011142;
      cpu->dbgdidr = 0x3515f021;
      cpu->clidr = 0x0a200023;
      cpu->ccsidr[0] = 0x701fe00a; /* 32K L1 dcache */
 diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu64.c
 +++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_a57_initfn(Object *obj)
      cpu->midr = 0x411fd070;
      cpu->revidr = 0x00000000;
      cpu->reset_fpsid = 0x41034070;
 -    cpu->mvfr0 = 0x10110222;
 -    cpu->mvfr1 = 0x12111111;
 -    cpu->mvfr2 = 0x00000043;
 +    cpu->isar.mvfr0 = 0x10110222;
 +    cpu->isar.mvfr1 = 0x12111111;
 +    cpu->isar.mvfr2 = 0x00000043;
      cpu->ctr = 0x8444c004;
      cpu->reset_sctlr = 0x00c50838;
      cpu->id_pfr0 = 0x00000131;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a57_initfn(Object *obj)
      cpu->id_mmfr1 = 0x40000000;
      cpu->id_mmfr2 = 0x01260000;
      cpu->id_mmfr3 = 0x02102211;
 -    cpu->id_isar0 = 0x02101110;
 -    cpu->id_isar1 = 0x13112111;
 -    cpu->id_isar2 = 0x21232042;
 -    cpu->id_isar3 = 0x01112131;
 -    cpu->id_isar4 = 0x00011142;
 -    cpu->id_isar5 = 0x00011121;
 -    cpu->id_isar6 = 0;
 -    cpu->id_aa64pfr0 = 0x00002222;
 +    cpu->isar.id_isar0 = 0x02101110;
 +    cpu->isar.id_isar1 = 0x13112111;
 +    cpu->isar.id_isar2 = 0x21232042;
 +    cpu->isar.id_isar3 = 0x01112131;
 +    cpu->isar.id_isar4 = 0x00011142;
 +    cpu->isar.id_isar5 = 0x00011121;
 +    cpu->isar.id_isar6 = 0;
 +    cpu->isar.id_aa64pfr0 = 0x00002222;
      cpu->id_aa64dfr0 = 0x10305106;
      cpu->pmceid0 = 0x00000000;
      cpu->pmceid1 = 0x00000000;
 -    cpu->id_aa64isar0 = 0x00011120;
 +    cpu->isar.id_aa64isar0 = 0x00011120;
      cpu->id_aa64mmfr0 = 0x00001124;
      cpu->dbgdidr = 0x3516d000;
      cpu->clidr = 0x0a200023;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a53_initfn(Object *obj)
      cpu->midr = 0x410fd034;
      cpu->revidr = 0x00000000;
      cpu->reset_fpsid = 0x41034070;
 -    cpu->mvfr0 = 0x10110222;
 -    cpu->mvfr1 = 0x12111111;
 -    cpu->mvfr2 = 0x00000043;
 +    cpu->isar.mvfr0 = 0x10110222;
 +    cpu->isar.mvfr1 = 0x12111111;
 +    cpu->isar.mvfr2 = 0x00000043;
      cpu->ctr = 0x84448004; /* L1Ip = VIPT */
      cpu->reset_sctlr = 0x00c50838;
      cpu->id_pfr0 = 0x00000131;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a53_initfn(Object *obj)
      cpu->id_mmfr1 = 0x40000000;
      cpu->id_mmfr2 = 0x01260000;
      cpu->id_mmfr3 = 0x02102211;
 -    cpu->id_isar0 = 0x02101110;
 -    cpu->id_isar1 = 0x13112111;
 -    cpu->id_isar2 = 0x21232042;
 -    cpu->id_isar3 = 0x01112131;
 -    cpu->id_isar4 = 0x00011142;
 -    cpu->id_isar5 = 0x00011121;
 -    cpu->id_isar6 = 0;
 -    cpu->id_aa64pfr0 = 0x00002222;
 +    cpu->isar.id_isar0 = 0x02101110;
 +    cpu->isar.id_isar1 = 0x13112111;
 +    cpu->isar.id_isar2 = 0x21232042;
 +    cpu->isar.id_isar3 = 0x01112131;
 +    cpu->isar.id_isar4 = 0x00011142;
 +    cpu->isar.id_isar5 = 0x00011121;
 +    cpu->isar.id_isar6 = 0;
 +    cpu->isar.id_aa64pfr0 = 0x00002222;
      cpu->id_aa64dfr0 = 0x10305106;
 -    cpu->id_aa64isar0 = 0x00011120;
 +    cpu->isar.id_aa64isar0 = 0x00011120;
      cpu->id_aa64mmfr0 = 0x00001122; /* 40 bit physical addr */
      cpu->dbgdidr = 0x3516d000;
      cpu->clidr = 0x0a200023;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a72_initfn(Object *obj)
      cpu->midr = 0x410fd083;
      cpu->revidr = 0x00000000;
      cpu->reset_fpsid = 0x41034080;
 -    cpu->mvfr0 = 0x10110222;
 -    cpu->mvfr1 = 0x12111111;
 -    cpu->mvfr2 = 0x00000043;
 +    cpu->isar.mvfr0 = 0x10110222;
 +    cpu->isar.mvfr1 = 0x12111111;
 +    cpu->isar.mvfr2 = 0x00000043;
      cpu->ctr = 0x8444c004;
      cpu->reset_sctlr = 0x00c50838;
      cpu->id_pfr0 = 0x00000131;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a72_initfn(Object *obj)
      cpu->id_mmfr1 = 0x40000000;
      cpu->id_mmfr2 = 0x01260000;
      cpu->id_mmfr3 = 0x02102211;
 -    cpu->id_isar0 = 0x02101110;
 -    cpu->id_isar1 = 0x13112111;
 -    cpu->id_isar2 = 0x21232042;
 -    cpu->id_isar3 = 0x01112131;
 -    cpu->id_isar4 = 0x00011142;
 -    cpu->id_isar5 = 0x00011121;
 -    cpu->id_aa64pfr0 = 0x00002222;
 +    cpu->isar.id_isar0 = 0x02101110;
 +    cpu->isar.id_isar1 = 0x13112111;
 +    cpu->isar.id_isar2 = 0x21232042;
 +    cpu->isar.id_isar3 = 0x01112131;
 +    cpu->isar.id_isar4 = 0x00011142;
 +    cpu->isar.id_isar5 = 0x00011121;
 +    cpu->isar.id_aa64pfr0 = 0x00002222;
      cpu->id_aa64dfr0 = 0x10305106;
      cpu->pmceid0 = 0x00000000;
      cpu->pmceid1 = 0x00000000;
 -    cpu->id_aa64isar0 = 0x00011120;
 +    cpu->isar.id_aa64isar0 = 0x00011120;
      cpu->id_aa64mmfr0 = 0x00001124;
      cpu->dbgdidr = 0x3516d000;
      cpu->clidr = 0x0a200023;
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static uint64_t id_pfr1_read(CPUARMState *env, const ARMCPRegInfo *ri)
  static uint64_t id_aa64pfr0_read(CPUARMState *env, const ARMCPRegInfo *ri)
  {
      ARMCPU *cpu = arm_env_get_cpu(env);
 -    uint64_t pfr0 = cpu->id_aa64pfr0;
 +    uint64_t pfr0 = cpu->isar.id_aa64pfr0;
      if (env->gicv3state) {
          pfr0 |= 1 << 24;
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
              { .name = "ID_ISAR0", .state = ARM_CP_STATE_BOTH,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 0,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_isar0 },
 +              .resetvalue = cpu->isar.id_isar0 },
              { .name = "ID_ISAR1", .state = ARM_CP_STATE_BOTH,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 1,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_isar1 },
 +              .resetvalue = cpu->isar.id_isar1 },
              { .name = "ID_ISAR2", .state = ARM_CP_STATE_BOTH,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 2,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_isar2 },
 +              .resetvalue = cpu->isar.id_isar2 },
              { .name = "ID_ISAR3", .state = ARM_CP_STATE_BOTH,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 3,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_isar3 },
 +              .resetvalue = cpu->isar.id_isar3 },
              { .name = "ID_ISAR4", .state = ARM_CP_STATE_BOTH,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 4,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_isar4 },
 +              .resetvalue = cpu->isar.id_isar4 },
              { .name = "ID_ISAR5", .state = ARM_CP_STATE_BOTH,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 5,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_isar5 },
 +              .resetvalue = cpu->isar.id_isar5 },
              { .name = "ID_MMFR4", .state = ARM_CP_STATE_BOTH,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 6,
                .access = PL1_R, .type = ARM_CP_CONST,
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
              { .name = "ID_ISAR6", .state = ARM_CP_STATE_BOTH,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 7,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_isar6 },
 +              .resetvalue = cpu->isar.id_isar6 },
              REGINFO_SENTINEL
          };
          define_arm_cp_regs(cpu, v6_idregs);
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
              { .name = "ID_AA64PFR1_EL1", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 4, .opc2 = 1,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_aa64pfr1},
 +              .resetvalue = cpu->isar.id_aa64pfr1},
              { .name = "ID_AA64PFR2_EL1_RESERVED", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 4, .opc2 = 2,
                .access = PL1_R, .type = ARM_CP_CONST,
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
              { .name = "ID_AA64ISAR0_EL1", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 6, .opc2 = 0,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_aa64isar0 },
 +              .resetvalue = cpu->isar.id_aa64isar0 },
              { .name = "ID_AA64ISAR1_EL1", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 6, .opc2 = 1,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->id_aa64isar1 },
 +              .resetvalue = cpu->isar.id_aa64isar1 },
              { .name = "ID_AA64ISAR2_EL1_RESERVED", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 6, .opc2 = 2,
                .access = PL1_R, .type = ARM_CP_CONST,
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
              { .name = "MVFR0_EL1", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 3, .opc2 = 0,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->mvfr0 },
 +              .resetvalue = cpu->isar.mvfr0 },
              { .name = "MVFR1_EL1", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 3, .opc2 = 1,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->mvfr1 },
 +              .resetvalue = cpu->isar.mvfr1 },
              { .name = "MVFR2_EL1", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 3, .opc2 = 2,
                .access = PL1_R, .type = ARM_CP_CONST,
 -              .resetvalue = cpu->mvfr2 },
 +              .resetvalue = cpu->isar.mvfr2 },
              { .name = "MVFR3_EL1_RESERVED", .state = ARM_CP_STATE_AA64,
                .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 3, .opc2 = 3,
                .access = PL1_R, .type = ARM_CP_CONST,
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 09/45] target/arm: Convert sve from feature bit to aa64pfr0 test
+[PULL 041/117] target/arm: Introduce gen_gvec_fn_zzi
 From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
+We have two places that perform this particular operation.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181016223115.24100-8-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-39-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.h            | 16 +++++++++++++++-
+ target/arm/translate-sve.c | 30 +++++++++++++++++-------------
- linux-user/aarch64/signal.c |  4 ++--
+file changed, 17 insertions(+), 13 deletions(-)
  linux-user/elfload.c        |  2 +-
  linux-user/syscall.c        | 10 ++++++----
  target/arm/cpu64.c          |  5 ++++-
  target/arm/helper.c         |  9 ++++++---
  target/arm/machine.c        |  3 +--
  target/arm/translate-a64.c  |  4 ++--
 files changed, 37 insertions(+), 16 deletions(-)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/cpu.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ FIELD(ID_AA64ISAR1, FRINTTS, 32, 4)
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_arg_zpzz(DisasContext *s, gen_helper_gvec_4 *fn,
- FIELD(ID_AA64ISAR1, SB, 36, 4)
+     return gen_gvec_ool_zzzp(s, fn, a->rd, a->rn, a->rm, a->pg, data);
  FIELD(ID_AA64ISAR1, SPECRES, 40, 4)
 +FIELD(ID_AA64PFR0, EL0, 0, 4)
 +FIELD(ID_AA64PFR0, EL1, 4, 4)
 +FIELD(ID_AA64PFR0, EL2, 8, 4)
 +FIELD(ID_AA64PFR0, EL3, 12, 4)
 +FIELD(ID_AA64PFR0, FP, 16, 4)
 +FIELD(ID_AA64PFR0, ADVSIMD, 20, 4)
 +FIELD(ID_AA64PFR0, GIC, 24, 4)
 +FIELD(ID_AA64PFR0, RAS, 28, 4)
 +FIELD(ID_AA64PFR0, SVE, 32, 4)
 +
  QEMU_BUILD_BUG_ON(ARRAY_SIZE(((ARMCPU *)0)->ccsidr) <= R_V7M_CSSELR_INDEX_MASK);
  /* If adding a feature bit which corresponds to a Linux ELF
@@ -XXX,XX +XXX,XX @@ enum arm_features {
      ARM_FEATURE_PMU, /* has PMU support */
      ARM_FEATURE_VBAR, /* has cp15 VBAR */
      ARM_FEATURE_M_SECURITY, /* M profile Security Extension */
 -    ARM_FEATURE_SVE, /* has Scalable Vector Extension */
      ARM_FEATURE_V8_FP16, /* implements v8.2 half-precision float */
      ARM_FEATURE_M_MAIN, /* M profile Main Extension */
  };
@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_aa64_fcma(const ARMISARegisters *id)
      return FIELD_EX64(id->id_aa64isar1, ID_AA64ISAR1, FCMA) != 0;
  }
-+static inline bool isar_feature_aa64_sve(const ARMISARegisters *id)
++/* Invoke a vector expander on two Zregs and an immediate.  */
 +static bool gen_gvec_fn_zzi(DisasContext *s, GVecGen2iFn *gvec_fn,
 +                            int esz, int rd, int rn, uint64_t imm)
 +{
-+    return FIELD_EX64(id->id_aa64pfr0, ID_AA64PFR0, SVE) != 0;
++    if (gvec_fn == NULL) {
 +        return false;
 +    }
 +    if (sve_access_check(s)) {
 +        unsigned vsz = vec_full_reg_size(s);
 +        gvec_fn(esz, vec_full_reg_offset(s, rd),
 +                vec_full_reg_offset(s, rn), imm, vsz, vsz);
 +    }
 +    return true;
 +}
 +
- /*
+ /* Invoke a vector expander on three Zregs.  */
-  * Forward to the above feature tests given an ARMCPU pointer.
+ static bool gen_gvec_fn_zzz(DisasContext *s, GVecGen3Fn *gvec_fn,
-  */
+                             int esz, int rd, int rn, int rm)
-diff --git a/linux-user/aarch64/signal.c b/linux-user/aarch64/signal.c
+@@ -XXX,XX +XXX,XX @@ static bool do_zz_dbm(DisasContext *s, arg_rr_dbm *a, GVecGen2iFn *gvec_fn)
-index XXXXXXX..XXXXXXX 100644
+                                 extract32(a->dbm, 6, 6))) {
---- a/linux-user/aarch64/signal.c
+         return false;
 +++ b/linux-user/aarch64/signal.c
@@ -XXX,XX +XXX,XX @@ static int target_restore_sigframe(CPUARMState *env,
              break;
          case TARGET_SVE_MAGIC:
 -            if (arm_feature(env, ARM_FEATURE_SVE)) {
 +            if (cpu_isar_feature(aa64_sve, arm_env_get_cpu(env))) {
                  vq = (env->vfp.zcr_el[1] & 0xf) + 1;
                  sve_size = QEMU_ALIGN_UP(TARGET_SVE_SIG_CONTEXT_SIZE(vq), 16);
                  if (!sve && size == sve_size) {
@@ -XXX,XX +XXX,XX @@ static void target_setup_frame(int usig, struct target_sigaction *ka,
                                        &layout);
      /* SVE state needs saving only if it exists.  */
 -    if (arm_feature(env, ARM_FEATURE_SVE)) {
 +    if (cpu_isar_feature(aa64_sve, arm_env_get_cpu(env))) {
          vq = (env->vfp.zcr_el[1] & 0xf) + 1;
          sve_size = QEMU_ALIGN_UP(TARGET_SVE_SIG_CONTEXT_SIZE(vq), 16);
          sve_ofs = alloc_sigframe_space(sve_size, &layout);
 diff --git a/linux-user/elfload.c b/linux-user/elfload.c
 index XXXXXXX..XXXXXXX 100644
 --- a/linux-user/elfload.c
 +++ b/linux-user/elfload.c
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
      GET_FEATURE_ID(aa64_rdm, ARM_HWCAP_A64_ASIMDRDM);
      GET_FEATURE_ID(aa64_dp, ARM_HWCAP_A64_ASIMDDP);
      GET_FEATURE_ID(aa64_fcma, ARM_HWCAP_A64_FCMA);
 -    GET_FEATURE(ARM_FEATURE_SVE, ARM_HWCAP_A64_SVE);
 +    GET_FEATURE_ID(aa64_sve, ARM_HWCAP_A64_SVE);
  #undef GET_FEATURE
  #undef GET_FEATURE_ID
 diff --git a/linux-user/syscall.c b/linux-user/syscall.c
 index XXXXXXX..XXXXXXX 100644
 --- a/linux-user/syscall.c
 +++ b/linux-user/syscall.c
@@ -XXX,XX +XXX,XX @@ static abi_long do_syscall1(void *cpu_env, int num, abi_long arg1,
               * even though the current architectural maximum is VQ=16.
               */
              ret = -TARGET_EINVAL;
 -            if (arm_feature(cpu_env, ARM_FEATURE_SVE)
 +            if (cpu_isar_feature(aa64_sve, arm_env_get_cpu(cpu_env))
                  && arg2 >= 0 && arg2 <= 512 * 16 && !(arg2 & 15)) {
                  CPUARMState *env = cpu_env;
                  ARMCPU *cpu = arm_env_get_cpu(env);
@@ -XXX,XX +XXX,XX @@ static abi_long do_syscall1(void *cpu_env, int num, abi_long arg1,
              return ret;
          case TARGET_PR_SVE_GET_VL:
              ret = -TARGET_EINVAL;
 -            if (arm_feature(cpu_env, ARM_FEATURE_SVE)) {
 -                CPUARMState *env = cpu_env;
 -                ret = ((env->vfp.zcr_el[1] & 0xf) + 1) * 16;
 +            {
 +                ARMCPU *cpu = arm_env_get_cpu(cpu_env);
 +                if (cpu_isar_feature(aa64_sve, cpu)) {
 +                    ret = ((cpu->env.vfp.zcr_el[1] & 0xf) + 1) * 16;
 +                }
              }
              return ret;
  #endif /* AARCH64 */
 diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu64.c
 +++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
          t = FIELD_DP64(t, ID_AA64ISAR1, FCMA, 1);
          cpu->isar.id_aa64isar1 = t;
 +        t = cpu->isar.id_aa64pfr0;
 +        t = FIELD_DP64(t, ID_AA64PFR0, SVE, 1);
 +        cpu->isar.id_aa64pfr0 = t;
 +
          /* Replicate the same data to the 32-bit id registers.  */
          u = cpu->isar.id_isar5;
          u = FIELD_DP32(u, ID_ISAR5, AES, 2); /* AES + PMULL */
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
           * present in either.
           */
          set_feature(&cpu->env, ARM_FEATURE_V8_FP16);
 -        set_feature(&cpu->env, ARM_FEATURE_SVE);
          /* For usermode -cpu max we can use a larger and more efficient DCZ
           * blocksize since we don't have to follow what the hardware does.
           */
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
          define_one_arm_cp_reg(cpu, &sctlr);
      }
+-    if (sve_access_check(s)) {
--    if (arm_feature(env, ARM_FEATURE_SVE)) {
+-        unsigned vsz = vec_full_reg_size(s);
-+    if (cpu_isar_feature(aa64_sve, cpu)) {
+-        gvec_fn(MO_64, vec_full_reg_offset(s, a->rd),
-         define_one_arm_cp_reg(cpu, &zcr_el1_reginfo);
+-                vec_full_reg_offset(s, a->rn), imm, vsz, vsz);
-         if (arm_feature(env, ARM_FEATURE_EL2)) {
+-    }
-             define_one_arm_cp_reg(cpu, &zcr_el2_reginfo);
+-    return true;
-@@ -XXX,XX +XXX,XX @@ void cpu_get_tb_cpu_state(CPUARMState *env, target_ulong *pc,
++    return gen_gvec_fn_zzi(s, gvec_fn, MO_64, a->rd, a->rn, imm);
-     uint32_t flags;
+ }
-     if (is_a64(env)) {
+ static bool trans_AND_zzi(DisasContext *s, arg_rr_dbm *a)
-+        ARMCPU *cpu = arm_env_get_cpu(env);
+@@ -XXX,XX +XXX,XX @@ static bool do_sve2_fn2i(DisasContext *s, arg_rri_esz *a, GVecGen2iFn *fn)
-+
+     if (a->esz < 0 || !dc_isar_feature(aa64_sve2, s)) {
-         *pc = env->pc;
+         return false;
          flags = ARM_TBFLAG_AARCH64_STATE_MASK;
          /* Get control bits for tagged addresses */
          flags |= (arm_regime_tbi0(env, mmu_idx) << ARM_TBFLAG_TBI0_SHIFT);
          flags |= (arm_regime_tbi1(env, mmu_idx) << ARM_TBFLAG_TBI1_SHIFT);
 -        if (arm_feature(env, ARM_FEATURE_SVE)) {
 +        if (cpu_isar_feature(aa64_sve, cpu)) {
              int sve_el = sve_exception_el(env, current_el);
              uint32_t zcr_len;
@@ -XXX,XX +XXX,XX @@ void aarch64_sve_narrow_vq(CPUARMState *env, unsigned vq)
  void aarch64_sve_change_el(CPUARMState *env, int old_el,
                             int new_el, bool el0_a64)
  {
 +    ARMCPU *cpu = arm_env_get_cpu(env);
      int old_len, new_len;
      bool old_a64, new_a64;
      /* Nothing to do if no SVE.  */
 -    if (!arm_feature(env, ARM_FEATURE_SVE)) {
 +    if (!cpu_isar_feature(aa64_sve, cpu)) {
          return;
      }
+-    if (sve_access_check(s)) {
-diff --git a/target/arm/machine.c b/target/arm/machine.c
+-        unsigned vsz = vec_full_reg_size(s);
-index XXXXXXX..XXXXXXX 100644
+-        unsigned rd_ofs = vec_full_reg_offset(s, a->rd);
---- a/target/arm/machine.c
+-        unsigned rn_ofs = vec_full_reg_offset(s, a->rn);
-+++ b/target/arm/machine.c
+-        fn(a->esz, rd_ofs, rn_ofs, a->imm, vsz, vsz);
-@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_iwmmxt = {
+-    }
- static bool sve_needed(void *opaque)
+-    return true;
- {
++    return gen_gvec_fn_zzi(s, fn, a->esz, a->rd, a->rn, a->imm);
      ARMCPU *cpu = opaque;
 -    CPUARMState *env = &cpu->env;
 -    return arm_feature(env, ARM_FEATURE_SVE);
 +    return cpu_isar_feature(aa64_sve, cpu);
  }
- /* The first two words of each Zreg is stored in VFP state.  */
+ static bool trans_SSRA(DisasContext *s, arg_rri_esz *a)
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ void aarch64_cpu_dump_state(CPUState *cs, FILE *f,
      cpu_fprintf(f, "     FPCR=%08x FPSR=%08x\n",
                  vfp_get_fpcr(env), vfp_get_fpsr(env));
 -    if (arm_feature(env, ARM_FEATURE_SVE) && sve_exception_el(env, el) == 0) {
 +    if (cpu_isar_feature(aa64_sve, cpu) && sve_exception_el(env, el) == 0) {
          int j, zcr_len = sve_zcr_len_for_el(env, el);
          for (i = 0; i <= FFR_PRED_NUM; i++) {
@@ -XXX,XX +XXX,XX @@ static void disas_a64_insn(CPUARMState *env, DisasContext *s)
          unallocated_encoding(s);
          break;
      case 0x2:
 -        if (!arm_dc_feature(s, ARM_FEATURE_SVE) || !disas_sve(s, insn)) {
 +        if (!dc_isar_feature(aa64_sve, s) || !disas_sve(s, insn)) {
              unallocated_encoding(s);
          }
          break;
 --
-.19.1
+.25.1

-New patch
+[PULL 042/117] target/arm: Use TRANS_FEAT for do_zz_dbm
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-40-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 17 +++--------------
+file changed, 3 insertions(+), 14 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_zz_dbm(DisasContext *s, arg_rr_dbm *a, GVecGen2iFn *gvec_fn)
+     return gen_gvec_fn_zzi(s, gvec_fn, MO_64, a->rd, a->rn, imm);
+ }
+-static bool trans_AND_zzi(DisasContext *s, arg_rr_dbm *a)
+-{
+-    return do_zz_dbm(s, a, tcg_gen_gvec_andi);
+-}
+-
+-static bool trans_ORR_zzi(DisasContext *s, arg_rr_dbm *a)
+-{
+-    return do_zz_dbm(s, a, tcg_gen_gvec_ori);
+-}
+-
+-static bool trans_EOR_zzi(DisasContext *s, arg_rr_dbm *a)
+-{
+-    return do_zz_dbm(s, a, tcg_gen_gvec_xori);
+-}
++TRANS_FEAT(AND_zzi, aa64_sve, do_zz_dbm, a, tcg_gen_gvec_andi)
++TRANS_FEAT(ORR_zzi, aa64_sve, do_zz_dbm, a, tcg_gen_gvec_ori)
++TRANS_FEAT(EOR_zzi, aa64_sve, do_zz_dbm, a, tcg_gen_gvec_xori)
+ static bool trans_DUPM(DisasContext *s, arg_DUPM *a)
+ {
+--
+.25.1

-New patch
+[PULL 043/117] target/arm: Hoist sve access check through do_sel_z
+From: Richard Henderson <richard.henderson@linaro.org>
+The check is already done in gen_gvec_ool_zzzp,
+which is called by do_sel_z; remove from callers.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-41-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 14 ++++----------
+file changed, 4 insertions(+), 10 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(UQSUB_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_ussub, a)
+ /* Select active elememnts from Zn and inactive elements from Zm,
+  * storing the result in Zd.
+  */
+-static void do_sel_z(DisasContext *s, int rd, int rn, int rm, int pg, int esz)
++static bool do_sel_z(DisasContext *s, int rd, int rn, int rm, int pg, int esz)
+ {
+     static gen_helper_gvec_4 * const fns[4] = {
+         gen_helper_sve_sel_zpzz_b, gen_helper_sve_sel_zpzz_h,
+         gen_helper_sve_sel_zpzz_s, gen_helper_sve_sel_zpzz_d
+     };
+-    gen_gvec_ool_zzzp(s, fns[esz], rd, rn, rm, pg, 0);
++    return gen_gvec_ool_zzzp(s, fns[esz], rd, rn, rm, pg, 0);
+ }
+ #define DO_ZPZZ(NAME, FEAT, name) \
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(UDIV_zpzz, aa64_sve, gen_gvec_ool_arg_zpzz, udiv_fns[a->esz], a, 0)
+ static bool trans_SEL_zpzz(DisasContext *s, arg_rprr_esz *a)
+ {
+-    if (sve_access_check(s)) {
+-        do_sel_z(s, a->rd, a->rn, a->rm, a->pg, a->esz);
+-    }
+-    return true;
++    return do_sel_z(s, a->rd, a->rn, a->rm, a->pg, a->esz);
+ }
+ /*
+@@ -XXX,XX +XXX,XX @@ static bool trans_MOVPRFX(DisasContext *s, arg_MOVPRFX *a)
+ static bool trans_MOVPRFX_m(DisasContext *s, arg_rpr_esz *a)
+ {
+-    if (sve_access_check(s)) {
+-        do_sel_z(s, a->rd, a->rn, a->rd, a->pg, a->esz);
+-    }
+-    return true;
++    return do_sel_z(s, a->rd, a->rn, a->rd, a->pg, a->esz);
+ }
+ static bool trans_MOVPRFX_z(DisasContext *s, arg_rpr_esz *a)
+--
+.25.1

-[Qemu-devel] [PULL 08/45] target/arm: Convert t32ee from feature bit to isar3 test
+[PULL 044/117] target/arm: Introduce gen_gvec_fn_arg_zzi
 From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
+We have two places that perform this particular operation.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181016223115.24100-7-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-42-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.h     | 6 +++++-
+ target/arm/translate-sve.c | 21 +++++++++++++--------
- linux-user/elfload.c | 2 +-
+file changed, 13 insertions(+), 8 deletions(-)
  target/arm/cpu.c     | 4 ----
  target/arm/helper.c  | 2 +-
  target/arm/machine.c | 3 +--
 files changed, 8 insertions(+), 9 deletions(-)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/cpu.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ enum arm_features {
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_fn_zzi(DisasContext *s, GVecGen2iFn *gvec_fn,
-     ARM_FEATURE_NEON,
+     return true;
      ARM_FEATURE_M, /* Microcontroller profile.  */
      ARM_FEATURE_OMAPCP, /* OMAP specific CP15 ops handling.  */
 -    ARM_FEATURE_THUMB2EE,
      ARM_FEATURE_V7MP,    /* v7 Multiprocessing Extensions */
      ARM_FEATURE_V7VE, /* v7 Virtualization Extensions (non-EL2 parts) */
      ARM_FEATURE_V4T,
@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_jazelle(const ARMISARegisters *id)
      return FIELD_EX32(id->id_isar1, ID_ISAR1, JAZELLE) != 0;
  }
-+static inline bool isar_feature_t32ee(const ARMISARegisters *id)
++static bool gen_gvec_fn_arg_zzi(DisasContext *s, GVecGen2iFn *gvec_fn,
 +                                arg_rri_esz *a)
 +{
-+    return FIELD_EX32(id->id_isar3, ID_ISAR3, T32EE) != 0;
++    if (a->esz < 0) {
 +        /* Invalid tsz encoding -- see tszimm_esz. */
 +        return false;
 +    }
 +    return gen_gvec_fn_zzi(s, gvec_fn, a->esz, a->rd, a->rn, a->imm);
 +}
 +
- static inline bool isar_feature_aa32_aes(const ARMISARegisters *id)
+ /* Invoke a vector expander on three Zregs.  */
  static bool gen_gvec_fn_zzz(DisasContext *s, GVecGen3Fn *gvec_fn,
                              int esz, int rd, int rn, int rm)
@@ -XXX,XX +XXX,XX @@ static bool trans_ADD_zzi(DisasContext *s, arg_rri_esz *a)
      if (a->esz == 0 && extract32(s->insn, 13, 1)) {
          return false;
      }
 -    if (sve_access_check(s)) {
 -        unsigned vsz = vec_full_reg_size(s);
 -        tcg_gen_gvec_addi(a->esz, vec_full_reg_offset(s, a->rd),
 -                          vec_full_reg_offset(s, a->rn), a->imm, vsz, vsz);
 -    }
 -    return true;
 +    return gen_gvec_fn_arg_zzi(s, tcg_gen_gvec_addi, a);
  }
  static bool trans_SUB_zzi(DisasContext *s, arg_rri_esz *a)
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(ADCLT, aa64_sve2, do_adcl, a, true)
  static bool do_sve2_fn2i(DisasContext *s, arg_rri_esz *a, GVecGen2iFn *fn)
  {
-     return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) != 0;
+-    if (a->esz < 0 || !dc_isar_feature(aa64_sve2, s)) {
-diff --git a/linux-user/elfload.c b/linux-user/elfload.c
++    if (!dc_isar_feature(aa64_sve2, s)) {
-index XXXXXXX..XXXXXXX 100644
+         return false;
 --- a/linux-user/elfload.c
 +++ b/linux-user/elfload.c
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
      GET_FEATURE(ARM_FEATURE_V5, ARM_HWCAP_ARM_EDSP);
      GET_FEATURE(ARM_FEATURE_VFP, ARM_HWCAP_ARM_VFP);
      GET_FEATURE(ARM_FEATURE_IWMMXT, ARM_HWCAP_ARM_IWMMXT);
 -    GET_FEATURE(ARM_FEATURE_THUMB2EE, ARM_HWCAP_ARM_THUMBEE);
 +    GET_FEATURE_ID(t32ee, ARM_HWCAP_ARM_THUMBEE);
      GET_FEATURE(ARM_FEATURE_NEON, ARM_HWCAP_ARM_NEON);
      GET_FEATURE(ARM_FEATURE_VFP3, ARM_HWCAP_ARM_VFPv3);
      GET_FEATURE(ARM_FEATURE_V6K, ARM_HWCAP_ARM_TLS);
 diff --git a/target/arm/cpu.c b/target/arm/cpu.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu.c
 +++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void cortex_a8_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_V7);
      set_feature(&cpu->env, ARM_FEATURE_VFP3);
      set_feature(&cpu->env, ARM_FEATURE_NEON);
 -    set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
      set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
      set_feature(&cpu->env, ARM_FEATURE_EL3);
      cpu->midr = 0x410fc080;
@@ -XXX,XX +XXX,XX @@ static void cortex_a9_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_VFP3);
      set_feature(&cpu->env, ARM_FEATURE_VFP_FP16);
      set_feature(&cpu->env, ARM_FEATURE_NEON);
 -    set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
      set_feature(&cpu->env, ARM_FEATURE_EL3);
      /* Note that A9 supports the MP extensions even for
       * A9UP and single-core A9MP (which are both different
@@ -XXX,XX +XXX,XX @@ static void cortex_a7_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_V7VE);
      set_feature(&cpu->env, ARM_FEATURE_VFP4);
      set_feature(&cpu->env, ARM_FEATURE_NEON);
 -    set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
      set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
      set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
      set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
@@ -XXX,XX +XXX,XX @@ static void cortex_a15_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_V7VE);
      set_feature(&cpu->env, ARM_FEATURE_VFP4);
      set_feature(&cpu->env, ARM_FEATURE_NEON);
 -    set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
      set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
      set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
      set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
          define_arm_cp_regs(cpu, vmsa_pmsa_cp_reginfo);
          define_arm_cp_regs(cpu, vmsa_cp_reginfo);
      }
--    if (arm_feature(env, ARM_FEATURE_THUMB2EE)) {
+-    return gen_gvec_fn_zzi(s, fn, a->esz, a->rd, a->rn, a->imm);
-+    if (cpu_isar_feature(t32ee, cpu)) {
++    return gen_gvec_fn_arg_zzi(s, fn, a);
          define_arm_cp_regs(cpu, t2ee_cp_reginfo);
      }
      if (arm_feature(env, ARM_FEATURE_GENERIC_TIMER)) {
 diff --git a/target/arm/machine.c b/target/arm/machine.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/machine.c
 +++ b/target/arm/machine.c
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_m = {
  static bool thumb2ee_needed(void *opaque)
  {
      ARMCPU *cpu = opaque;
 -    CPUARMState *env = &cpu->env;
 -    return arm_feature(env, ARM_FEATURE_THUMB2EE);
 +    return cpu_isar_feature(t32ee, cpu);
  }
- static const VMStateDescription vmstate_thumb2ee = {
+ static bool trans_SSRA(DisasContext *s, arg_rri_esz *a)
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 36/45] target/arm: Use gvec for NEON_3R_VML
+[PULL 045/117] target/arm: Use TRANS_FEAT for do_sve2_fn2i
 From: Richard Henderson <richard.henderson@linaro.org>
-Move mla_op and mls_op expanders from translate-a64.c.
+Convert SVE translation functions using do_sve2_fn2i
 to use TRANS_FEAT and gen_gvec_fn_arg_zzi.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-16-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-43-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.h     |   2 +
+ target/arm/translate-sve.c | 43 ++++++--------------------------------
- target/arm/translate-a64.c | 106 -----------------------------
+file changed, 6 insertions(+), 37 deletions(-)
  target/arm/translate.c     | 134 ++++++++++++++++++++++++++++++++-----
 files changed, 120 insertions(+), 122 deletions(-)
-diff --git a/target/arm/translate.h b/target/arm/translate.h
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static inline TCGv_i32 get_ahp_flag(void)
+@@ -XXX,XX +XXX,XX @@ static bool do_adcl(DisasContext *s, arg_rrrr_esz *a, bool sel)
- extern const GVecGen3 bsl_op;
+ TRANS_FEAT(ADCLB, aa64_sve2, do_adcl, a, false)
- extern const GVecGen3 bit_op;
+ TRANS_FEAT(ADCLT, aa64_sve2, do_adcl, a, true)
- extern const GVecGen3 bif_op;
-+extern const GVecGen3 mla_op[4];
+-static bool do_sve2_fn2i(DisasContext *s, arg_rri_esz *a, GVecGen2iFn *fn)
 +extern const GVecGen3 mls_op[4];
  extern const GVecGen2i ssra_op[4];
  extern const GVecGen2i usra_op[4];
  extern const GVecGen2i sri_op[4];
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_simd_3same_float(DisasContext *s, uint32_t insn)
      }
  }
 -static void gen_mla8_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
 -{
--    gen_helper_neon_mul_u8(a, a, b);
+-    if (!dc_isar_feature(aa64_sve2, s)) {
--    gen_helper_neon_add_u8(d, d, a);
+-        return false;
 -    }
 -    return gen_gvec_fn_arg_zzi(s, fn, a);
 -}
 -
--static void gen_mla16_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
+-static bool trans_SSRA(DisasContext *s, arg_rri_esz *a)
 -{
--    gen_helper_neon_mul_u16(a, a, b);
+-    return do_sve2_fn2i(s, a, gen_gvec_ssra);
 -    gen_helper_neon_add_u16(d, d, a);
 -}
 -
--static void gen_mla32_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
+-static bool trans_USRA(DisasContext *s, arg_rri_esz *a)
 -{
--    tcg_gen_mul_i32(a, a, b);
+-    return do_sve2_fn2i(s, a, gen_gvec_usra);
 -    tcg_gen_add_i32(d, d, a);
 -}
 -
--static void gen_mla64_i64(TCGv_i64 d, TCGv_i64 a, TCGv_i64 b)
+-static bool trans_SRSRA(DisasContext *s, arg_rri_esz *a)
 -{
--    tcg_gen_mul_i64(a, a, b);
+-    return do_sve2_fn2i(s, a, gen_gvec_srsra);
 -    tcg_gen_add_i64(d, d, a);
 -}
 -
--static void gen_mla_vec(unsigned vece, TCGv_vec d, TCGv_vec a, TCGv_vec b)
+-static bool trans_URSRA(DisasContext *s, arg_rri_esz *a)
 -{
--    tcg_gen_mul_vec(vece, a, a, b);
+-    return do_sve2_fn2i(s, a, gen_gvec_ursra);
 -    tcg_gen_add_vec(vece, d, d, a);
 -}
 -
--static void gen_mls8_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
+-static bool trans_SRI(DisasContext *s, arg_rri_esz *a)
 -{
--    gen_helper_neon_mul_u8(a, a, b);
+-    return do_sve2_fn2i(s, a, gen_gvec_sri);
 -    gen_helper_neon_sub_u8(d, d, a);
 -}
 -
--static void gen_mls16_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
+-static bool trans_SLI(DisasContext *s, arg_rri_esz *a)
 -{
--    gen_helper_neon_mul_u16(a, a, b);
+-    return do_sve2_fn2i(s, a, gen_gvec_sli);
 -    gen_helper_neon_sub_u16(d, d, a);
 -}
--
++TRANS_FEAT(SSRA, aa64_sve2, gen_gvec_fn_arg_zzi, gen_gvec_ssra, a)
--static void gen_mls32_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
++TRANS_FEAT(USRA, aa64_sve2, gen_gvec_fn_arg_zzi, gen_gvec_usra, a)
--{
++TRANS_FEAT(SRSRA, aa64_sve2, gen_gvec_fn_arg_zzi, gen_gvec_srsra, a)
--    tcg_gen_mul_i32(a, a, b);
++TRANS_FEAT(URSRA, aa64_sve2, gen_gvec_fn_arg_zzi, gen_gvec_ursra, a)
--    tcg_gen_sub_i32(d, d, a);
++TRANS_FEAT(SRI, aa64_sve2, gen_gvec_fn_arg_zzi, gen_gvec_sri, a)
--}
++TRANS_FEAT(SLI, aa64_sve2, gen_gvec_fn_arg_zzi, gen_gvec_sli, a)
--
--static void gen_mls64_i64(TCGv_i64 d, TCGv_i64 a, TCGv_i64 b)
+ TRANS_FEAT(SABA, aa64_sve2, gen_gvec_fn_arg_zzz, gen_gvec_saba, a)
--{
+ TRANS_FEAT(UABA, aa64_sve2, gen_gvec_fn_arg_zzz, gen_gvec_uaba, a)
 -    tcg_gen_mul_i64(a, a, b);
 -    tcg_gen_sub_i64(d, d, a);
 -}
 -
 -static void gen_mls_vec(unsigned vece, TCGv_vec d, TCGv_vec a, TCGv_vec b)
 -{
 -    tcg_gen_mul_vec(vece, a, a, b);
 -    tcg_gen_sub_vec(vece, d, d, a);
 -}
 -
  /* Integer op subgroup of C3.6.16. */
  static void disas_simd_3same_int(DisasContext *s, uint32_t insn)
  {
@@ -XXX,XX +XXX,XX @@ static void disas_simd_3same_int(DisasContext *s, uint32_t insn)
            .prefer_i64 = TCG_TARGET_REG_BITS == 64,
            .vece = MO_64 },
      };
 -    static const GVecGen3 mla_op[4] = {
 -        { .fni4 = gen_mla8_i32,
 -          .fniv = gen_mla_vec,
 -          .opc = INDEX_op_mul_vec,
 -          .load_dest = true,
 -          .vece = MO_8 },
 -        { .fni4 = gen_mla16_i32,
 -          .fniv = gen_mla_vec,
 -          .opc = INDEX_op_mul_vec,
 -          .load_dest = true,
 -          .vece = MO_16 },
 -        { .fni4 = gen_mla32_i32,
 -          .fniv = gen_mla_vec,
 -          .opc = INDEX_op_mul_vec,
 -          .load_dest = true,
 -          .vece = MO_32 },
 -        { .fni8 = gen_mla64_i64,
 -          .fniv = gen_mla_vec,
 -          .opc = INDEX_op_mul_vec,
 -          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -          .load_dest = true,
 -          .vece = MO_64 },
 -    };
 -    static const GVecGen3 mls_op[4] = {
 -        { .fni4 = gen_mls8_i32,
 -          .fniv = gen_mls_vec,
 -          .opc = INDEX_op_mul_vec,
 -          .load_dest = true,
 -          .vece = MO_8 },
 -        { .fni4 = gen_mls16_i32,
 -          .fniv = gen_mls_vec,
 -          .opc = INDEX_op_mul_vec,
 -          .load_dest = true,
 -          .vece = MO_16 },
 -        { .fni4 = gen_mls32_i32,
 -          .fniv = gen_mls_vec,
 -          .opc = INDEX_op_mul_vec,
 -          .load_dest = true,
 -          .vece = MO_32 },
 -        { .fni8 = gen_mls64_i64,
 -          .fniv = gen_mls_vec,
 -          .opc = INDEX_op_mul_vec,
 -          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -          .load_dest = true,
 -          .vece = MO_64 },
 -    };
      int is_q = extract32(insn, 30, 1);
      int u = extract32(insn, 29, 1);
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void gen_neon_narrow_op(int op, int u, int size,
  #define NEON_3R_VABA 15
  #define NEON_3R_VADD_VSUB 16
  #define NEON_3R_VTST_VCEQ 17
 -#define NEON_3R_VML 18 /* VMLA, VMLAL, VMLS, VMLSL */
 +#define NEON_3R_VML 18 /* VMLA, VMLS */
  #define NEON_3R_VMUL 19
  #define NEON_3R_VPMAX 20
  #define NEON_3R_VPMIN 21
@@ -XXX,XX +XXX,XX @@ const GVecGen2i sli_op[4] = {
        .vece = MO_64 },
  };
 +static void gen_mla8_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
 +{
 +    gen_helper_neon_mul_u8(a, a, b);
 +    gen_helper_neon_add_u8(d, d, a);
 +}
 +
 +static void gen_mls8_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
 +{
 +    gen_helper_neon_mul_u8(a, a, b);
 +    gen_helper_neon_sub_u8(d, d, a);
 +}
 +
 +static void gen_mla16_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
 +{
 +    gen_helper_neon_mul_u16(a, a, b);
 +    gen_helper_neon_add_u16(d, d, a);
 +}
 +
 +static void gen_mls16_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
 +{
 +    gen_helper_neon_mul_u16(a, a, b);
 +    gen_helper_neon_sub_u16(d, d, a);
 +}
 +
 +static void gen_mla32_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
 +{
 +    tcg_gen_mul_i32(a, a, b);
 +    tcg_gen_add_i32(d, d, a);
 +}
 +
 +static void gen_mls32_i32(TCGv_i32 d, TCGv_i32 a, TCGv_i32 b)
 +{
 +    tcg_gen_mul_i32(a, a, b);
 +    tcg_gen_sub_i32(d, d, a);
 +}
 +
 +static void gen_mla64_i64(TCGv_i64 d, TCGv_i64 a, TCGv_i64 b)
 +{
 +    tcg_gen_mul_i64(a, a, b);
 +    tcg_gen_add_i64(d, d, a);
 +}
 +
 +static void gen_mls64_i64(TCGv_i64 d, TCGv_i64 a, TCGv_i64 b)
 +{
 +    tcg_gen_mul_i64(a, a, b);
 +    tcg_gen_sub_i64(d, d, a);
 +}
 +
 +static void gen_mla_vec(unsigned vece, TCGv_vec d, TCGv_vec a, TCGv_vec b)
 +{
 +    tcg_gen_mul_vec(vece, a, a, b);
 +    tcg_gen_add_vec(vece, d, d, a);
 +}
 +
 +static void gen_mls_vec(unsigned vece, TCGv_vec d, TCGv_vec a, TCGv_vec b)
 +{
 +    tcg_gen_mul_vec(vece, a, a, b);
 +    tcg_gen_sub_vec(vece, d, d, a);
 +}
 +
 +/* Note that while NEON does not support VMLA and VMLS as 64-bit ops,
 + * these tables are shared with AArch64 which does support them.
 + */
 +const GVecGen3 mla_op[4] = {
 +    { .fni4 = gen_mla8_i32,
 +      .fniv = gen_mla_vec,
 +      .opc = INDEX_op_mul_vec,
 +      .load_dest = true,
 +      .vece = MO_8 },
 +    { .fni4 = gen_mla16_i32,
 +      .fniv = gen_mla_vec,
 +      .opc = INDEX_op_mul_vec,
 +      .load_dest = true,
 +      .vece = MO_16 },
 +    { .fni4 = gen_mla32_i32,
 +      .fniv = gen_mla_vec,
 +      .opc = INDEX_op_mul_vec,
 +      .load_dest = true,
 +      .vece = MO_32 },
 +    { .fni8 = gen_mla64_i64,
 +      .fniv = gen_mla_vec,
 +      .opc = INDEX_op_mul_vec,
 +      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 +      .load_dest = true,
 +      .vece = MO_64 },
 +};
 +
 +const GVecGen3 mls_op[4] = {
 +    { .fni4 = gen_mls8_i32,
 +      .fniv = gen_mls_vec,
 +      .opc = INDEX_op_mul_vec,
 +      .load_dest = true,
 +      .vece = MO_8 },
 +    { .fni4 = gen_mls16_i32,
 +      .fniv = gen_mls_vec,
 +      .opc = INDEX_op_mul_vec,
 +      .load_dest = true,
 +      .vece = MO_16 },
 +    { .fni4 = gen_mls32_i32,
 +      .fniv = gen_mls_vec,
 +      .opc = INDEX_op_mul_vec,
 +      .load_dest = true,
 +      .vece = MO_32 },
 +    { .fni8 = gen_mls64_i64,
 +      .fniv = gen_mls_vec,
 +      .opc = INDEX_op_mul_vec,
 +      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 +      .load_dest = true,
 +      .vece = MO_64 },
 +};
 +
  /* Translate a NEON data processing instruction.  Return nonzero if the
     instruction is invalid.
     We process data in a mixture of 32-bit and 64-bit chunks.
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                  return 0;
              }
              break;
 +
 +        case NEON_3R_VML: /* VMLA, VMLS */
 +            tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs, vec_size, vec_size,
 +                           u ? &mls_op[size] : &mla_op[size]);
 +            return 0;
          }
 +
          if (size == 3) {
              /* 64-bit element instructions. */
              for (pass = 0; pass < (q ? 2 : 1); pass++) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                  }
              }
              break;
 -        case NEON_3R_VML: /* VMLA, VMLAL, VMLS,VMLSL */
 -            switch (size) {
 -            case 0: gen_helper_neon_mul_u8(tmp, tmp, tmp2); break;
 -            case 1: gen_helper_neon_mul_u16(tmp, tmp, tmp2); break;
 -            case 2: tcg_gen_mul_i32(tmp, tmp, tmp2); break;
 -            default: abort();
 -            }
 -            tcg_temp_free_i32(tmp2);
 -            tmp2 = neon_load_reg(rd, pass);
 -            if (u) { /* VMLS */
 -                gen_neon_rsb(size, tmp, tmp2);
 -            } else { /* VMLA */
 -                gen_neon_add(size, tmp, tmp2);
 -            }
 -            break;
          case NEON_3R_VMUL:
              /* VMUL.P8; other cases already eliminated.  */
              gen_helper_neon_mul_p8(tmp, tmp, tmp2);
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 33/45] target/arm: Use gvec for VSHR, VSHL
+[PULL 046/117] target/arm: Use TRANS_FEAT for do_vpz_ool
 From: Richard Henderson <richard.henderson@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-13-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-44-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 70 +++++++++++++++++++++++++++++-------------
+ target/arm/translate-sve.c | 20 +++++++-------------
-file changed, 48 insertions(+), 22 deletions(-)
+file changed, 7 insertions(+), 13 deletions(-)
-diff --git a/target/arm/translate.c b/target/arm/translate.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static bool do_vpz_ool(DisasContext *s, arg_rpr_esz *a,
-                     size--;
+ }
-             }
-             shift = (insn >> 16) & ((1 << (3 + size)) - 1);
+ #define DO_VPZ(NAME, name) \
--            /* To avoid excessive duplication of ops we implement shift
+-static bool trans_##NAME(DisasContext *s, arg_rpr_esz *a)                \
--               by immediate using the variable shift operations.  */
+-{                                                                        \
-             if (op < 8) {
+-    static gen_helper_gvec_reduc * const fns[4] = {                      \
-                 /* Shift by immediate:
++    static gen_helper_gvec_reduc * const name##_fns[4] = {               \
-                    VSHR, VSRA, VRSHR, VRSRA, VSRI, VSHL, VQSHL, VQSHLU.  */
+         gen_helper_sve_##name##_b, gen_helper_sve_##name##_h,            \
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+         gen_helper_sve_##name##_s, gen_helper_sve_##name##_d,            \
-                 }
+     };                                                                   \
-                 /* Right shifts are encoded as N - shift, where N is the
+-    return do_vpz_ool(s, a, fns[a->esz]);                                \
-                    element size in bits.  */
+-}
--                if (op <= 4)
++    TRANS_FEAT(NAME, aa64_sve, do_vpz_ool, a, name##_fns[a->esz])
-+                if (op <= 4) {
-                     shift = shift - (1 << (size + 3));
+ DO_VPZ(ORV, orv)
-+                }
+ DO_VPZ(ANDV, andv)
-+
+@@ -XXX,XX +XXX,XX @@ DO_VPZ(UMAXV, umaxv)
-+                switch (op) {
+ DO_VPZ(SMINV, sminv)
-+                case 0:  /* VSHR */
+ DO_VPZ(UMINV, uminv)
-+                    /* Right shift comes here negative.  */
-+                    shift = -shift;
+-static bool trans_SADDV(DisasContext *s, arg_rpr_esz *a)
-+                    /* Shifts larger than the element size are architecturally
+-{
-+                     * valid.  Unsigned results in all zeros; signed results
+-    static gen_helper_gvec_reduc * const fns[4] = {
-+                     * in all sign bits.
+-        gen_helper_sve_saddv_b, gen_helper_sve_saddv_h,
-+                     */
+-        gen_helper_sve_saddv_s, NULL
-+                    if (!u) {
+-    };
-+                        tcg_gen_gvec_sari(size, rd_ofs, rm_ofs,
+-    return do_vpz_ool(s, a, fns[a->esz]);
-+                                          MIN(shift, (8 << size) - 1),
+-}
-+                                          vec_size, vec_size);
++static gen_helper_gvec_reduc * const saddv_fns[4] = {
-+                    } else if (shift >= 8 << size) {
++    gen_helper_sve_saddv_b, gen_helper_sve_saddv_h,
-+                        tcg_gen_gvec_dup8i(rd_ofs, vec_size, vec_size, 0);
++    gen_helper_sve_saddv_s, NULL
-+                    } else {
++};
-+                        tcg_gen_gvec_shri(size, rd_ofs, rm_ofs, shift,
++TRANS_FEAT(SADDV, aa64_sve, do_vpz_ool, a, saddv_fns[a->esz])
-+                                          vec_size, vec_size);
-+                    }
+ #undef DO_VPZ
 +                    return 0;
 +
 +                case 5: /* VSHL, VSLI */
 +                    if (!u) { /* VSHL */
 +                        /* Shifts larger than the element size are
 +                         * architecturally valid and results in zero.
 +                         */
 +                        if (shift >= 8 << size) {
 +                            tcg_gen_gvec_dup8i(rd_ofs, vec_size, vec_size, 0);
 +                        } else {
 +                            tcg_gen_gvec_shli(size, rd_ofs, rm_ofs, shift,
 +                                              vec_size, vec_size);
 +                        }
 +                        return 0;
 +                    }
 +                    break;
 +                }
 +
                  if (size == 3) {
                      count = q + 1;
                  } else {
                      count = q ? 4: 2;
                  }
 -                switch (size) {
 -                case 0:
 -                    imm = (uint8_t) shift;
 -                    imm |= imm << 8;
 -                    imm |= imm << 16;
 -                    break;
 -                case 1:
 -                    imm = (uint16_t) shift;
 -                    imm |= imm << 16;
 -                    break;
 -                case 2:
 -                case 3:
 -                    imm = shift;
 -                    break;
 -                default:
 -                    abort();
 -                }
 +
 +                /* To avoid excessive duplication of ops we implement shift
 +                 * by immediate using the variable shift operations.
 +                  */
 +                imm = dup_const(size, shift);
                  for (pass = 0; pass < count; pass++) {
                      if (size == 3) {
                          neon_load_reg64(cpu_V0, rm + pass);
                          tcg_gen_movi_i64(cpu_V1, imm);
                          switch (op) {
 -                        case 0:  /* VSHR */
                          case 1:  /* VSRA */
                              if (u)
                                  gen_helper_neon_shl_u64(cpu_V0, cpu_V0, cpu_V1);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                                                           cpu_V0, cpu_V1);
                              }
                              break;
 +                        default:
 +                            g_assert_not_reached();
                          }
                          if (op == 1 || op == 3) {
                              /* Accumulate.  */
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                          tmp2 = tcg_temp_new_i32();
                          tcg_gen_movi_i32(tmp2, imm);
                          switch (op) {
 -                        case 0:  /* VSHR */
                          case 1:  /* VSRA */
                              GEN_NEON_INTEGER_OP(shl);
                              break;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                          case 7: /* VQSHL */
                              GEN_NEON_INTEGER_OP_ENV(qshl);
                              break;
 +                        default:
 +                            g_assert_not_reached();
                          }
                          tcg_temp_free_i32(tmp2);
 --
-.19.1
+.25.1

-New patch
+[PULL 047/117] target/arm: Use TRANS_FEAT for do_shift_imm
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-45-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 17 +++--------------
+file changed, 3 insertions(+), 14 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_shift_imm(DisasContext *s, arg_rri_esz *a, bool asr,
+     return true;
+ }
+-static bool trans_ASR_zzi(DisasContext *s, arg_rri_esz *a)
+-{
+-    return do_shift_imm(s, a, true, tcg_gen_gvec_sari);
+-}
+-
+-static bool trans_LSR_zzi(DisasContext *s, arg_rri_esz *a)
+-{
+-    return do_shift_imm(s, a, false, tcg_gen_gvec_shri);
+-}
+-
+-static bool trans_LSL_zzi(DisasContext *s, arg_rri_esz *a)
+-{
+-    return do_shift_imm(s, a, false, tcg_gen_gvec_shli);
+-}
++TRANS_FEAT(ASR_zzi, aa64_sve, do_shift_imm, a, true, tcg_gen_gvec_sari)
++TRANS_FEAT(LSR_zzi, aa64_sve, do_shift_imm, a, false, tcg_gen_gvec_shri)
++TRANS_FEAT(LSL_zzi, aa64_sve, do_shift_imm, a, false, tcg_gen_gvec_shli)
+ #define DO_ZZW(NAME, name) \
+     static gen_helper_gvec_3 * const name##_zzw_fns[4] = {                \
+--
+.25.1

-[Qemu-devel] [PULL 25/45] target/arm: Promote consecutive memory ops for aa64
+[PULL 048/117] target/arm: Introduce do_shift_zpzi
 From: Richard Henderson <richard.henderson@linaro.org>
-For a sequence of loads or stores from a single register,
+Share code between the various shifts using arg_rpri_esz.
 little-endian operations can be promoted to an 8-byte op.
 This can reduce the number of operations by a factor of 8.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-5-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-46-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate-a64.c | 66 +++++++++++++++++++++++---------------
+ target/arm/translate-sve.c | 68 +++++++++++++++++---------------------
-file changed, 40 insertions(+), 26 deletions(-)
+file changed, 30 insertions(+), 38 deletions(-)
-diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-a64.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate-a64.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static void write_vec_element_i32(DisasContext *s, TCGv_i32 tcg_src,
+@@ -XXX,XX +XXX,XX @@ static bool do_movz_zpz(DisasContext *s, int rd, int rn, int pg,
+     return gen_gvec_ool_zzp(s, fns[esz], rd, rn, pg, invert);
  /* Store from vector register to memory */
  static void do_vec_st(DisasContext *s, int srcidx, int element,
 -                      TCGv_i64 tcg_addr, int size)
 +                      TCGv_i64 tcg_addr, int size, TCGMemOp endian)
  {
 -    TCGMemOp memop = s->be_data + size;
      TCGv_i64 tcg_tmp = tcg_temp_new_i64();
      read_vec_element(s, tcg_tmp, srcidx, element, size);
 -    tcg_gen_qemu_st_i64(tcg_tmp, tcg_addr, get_mem_index(s), memop);
 +    tcg_gen_qemu_st_i64(tcg_tmp, tcg_addr, get_mem_index(s), endian | size);
      tcg_temp_free_i64(tcg_tmp);
  }
- /* Load from memory to vector register */
++static bool do_shift_zpzi(DisasContext *s, arg_rpri_esz *a, bool asr,
- static void do_vec_ld(DisasContext *s, int destidx, int element,
++                          gen_helper_gvec_3 * const fns[4])
--                      TCGv_i64 tcg_addr, int size)
++{
-+                      TCGv_i64 tcg_addr, int size, TCGMemOp endian)
++    int max;
- {
++
--    TCGMemOp memop = s->be_data + size;
++    if (a->esz < 0) {
-     TCGv_i64 tcg_tmp = tcg_temp_new_i64();
++        /* Invalid tsz encoding -- see tszimm_esz. */
++        return false;
 -    tcg_gen_qemu_ld_i64(tcg_tmp, tcg_addr, get_mem_index(s), memop);
 +    tcg_gen_qemu_ld_i64(tcg_tmp, tcg_addr, get_mem_index(s), endian | size);
      write_vec_element(s, tcg_tmp, destidx, element, size);
      tcg_temp_free_i64(tcg_tmp);
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
      bool is_postidx = extract32(insn, 23, 1);
      bool is_q = extract32(insn, 30, 1);
      TCGv_i64 tcg_addr, tcg_rn, tcg_ebytes;
 +    TCGMemOp endian = s->be_data;
 -    int ebytes = 1 << size;
 -    int elements = (is_q ? 128 : 64) / (8 << size);
 +    int ebytes;   /* bytes per element */
 +    int elements; /* elements per vector */
      int rpt;    /* num iterations */
      int selem;  /* structure elements */
      int r;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
          gen_check_sp_alignment(s);
      }
 +    /* For our purposes, bytes are always little-endian.  */
 +    if (size == 0) {
 +        endian = MO_LE;
 +    }
 +
-+    /* Consecutive little-endian elements from a single register
++    /*
-+     * can be promoted to a larger little-endian operation.
++     * Shift by element size is architecturally valid.
 +     * For arithmetic right-shift, it's the same as by one less.
 +     * For logical shifts and ASRD, it is a zeroing operation.
 +     */
-+    if (selem == 1 && endian == MO_LE) {
++    max = 8 << a->esz;
-+        size = 3;
++    if (a->imm >= max) {
-+    }
++        if (asr) {
-+    ebytes = 1 << size;
++            a->imm = max - 1;
-+    elements = (is_q ? 16 : 8) / ebytes;
++        } else {
-+
++            return do_movz_zpz(s, a->rd, a->rd, a->pg, a->esz, true);
      tcg_rn = cpu_reg_sp(s, rn);
      tcg_addr = tcg_temp_new_i64();
      tcg_gen_mov_i64(tcg_addr, tcg_rn);
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
      for (r = 0; r < rpt; r++) {
          int e;
          for (e = 0; e < elements; e++) {
 -            int tt = (rt + r) % 32;
              int xs;
              for (xs = 0; xs < selem; xs++) {
 +                int tt = (rt + r + xs) % 32;
                  if (is_store) {
 -                    do_vec_st(s, tt, e, tcg_addr, size);
 +                    do_vec_st(s, tt, e, tcg_addr, size, endian);
                  } else {
 -                    do_vec_ld(s, tt, e, tcg_addr, size);
 -
 -                    /* For non-quad operations, setting a slice of the low
 -                     * 64 bits of the register clears the high 64 bits (in
 -                     * the ARM ARM pseudocode this is implicit in the fact
 -                     * that 'rval' is a 64 bit wide variable).
 -                     * For quad operations, we might still need to zero the
 -                     * high bits of SVE.  We optimize by noticing that we only
 -                     * need to do this the first time we touch a register.
 -                     */
 -                    if (e == 0 && (r == 0 || xs == selem - 1)) {
 -                        clear_vec_high(s, is_q, tt);
 -                    }
 +                    do_vec_ld(s, tt, e, tcg_addr, size, endian);
                  }
                  tcg_gen_add_i64(tcg_addr, tcg_addr, tcg_ebytes);
 -                tt = (tt + 1) % 32;
              }
          }
      }
 +    if (!is_store) {
 +        /* For non-quad operations, setting a slice of the low
 +         * 64 bits of the register clears the high 64 bits (in
 +         * the ARM ARM pseudocode this is implicit in the fact
 +         * that 'rval' is a 64 bit wide variable).
 +         * For quad operations, we might still need to zero the
 +         * high bits of SVE.
 +         */
 +        for (r = 0; r < rpt * selem; r++) {
 +            int tt = (rt + r) % 32;
 +            clear_vec_high(s, is_q, tt);
 +        }
 +    }
++    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
++}
 +
-     if (is_postidx) {
+ static bool trans_ASR_zpzi(DisasContext *s, arg_rpri_esz *a)
-         int rm = extract32(insn, 16, 5);
+ {
-         if (rm == 31) {
+     static gen_helper_gvec_3 * const fns[4] = {
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
+         gen_helper_sve_asr_zpzi_b, gen_helper_sve_asr_zpzi_h,
-         } else {
+         gen_helper_sve_asr_zpzi_s, gen_helper_sve_asr_zpzi_d,
-             /* Load/store one element per register */
+     };
-             if (is_load) {
+-    if (a->esz < 0) {
--                do_vec_ld(s, rt, index, tcg_addr, scale);
+-        /* Invalid tsz encoding -- see tszimm_esz. */
-+                do_vec_ld(s, rt, index, tcg_addr, scale, s->be_data);
+-        return false;
-             } else {
+-    }
--                do_vec_st(s, rt, index, tcg_addr, scale);
+-    /* Shift by element size is architecturally valid.  For
-+                do_vec_st(s, rt, index, tcg_addr, scale, s->be_data);
+-       arithmetic right-shift, it's the same as by one less. */
-             }
+-    a->imm = MIN(a->imm, (8 << a->esz) - 1);
-         }
+-    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
-         tcg_gen_add_i64(tcg_addr, tcg_addr, tcg_ebytes);
++    return do_shift_zpzi(s, a, true, fns);
  }
  static bool trans_LSR_zpzi(DisasContext *s, arg_rpri_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_LSR_zpzi(DisasContext *s, arg_rpri_esz *a)
          gen_helper_sve_lsr_zpzi_b, gen_helper_sve_lsr_zpzi_h,
          gen_helper_sve_lsr_zpzi_s, gen_helper_sve_lsr_zpzi_d,
      };
 -    if (a->esz < 0) {
 -        return false;
 -    }
 -    /* Shift by element size is architecturally valid.
 -       For logical shifts, it is a zeroing operation.  */
 -    if (a->imm >= (8 << a->esz)) {
 -        return do_movz_zpz(s, a->rd, a->rd, a->pg, a->esz, true);
 -    } else {
 -        return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
 -    }
 +    return do_shift_zpzi(s, a, false, fns);
  }
  static bool trans_LSL_zpzi(DisasContext *s, arg_rpri_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_LSL_zpzi(DisasContext *s, arg_rpri_esz *a)
          gen_helper_sve_lsl_zpzi_b, gen_helper_sve_lsl_zpzi_h,
          gen_helper_sve_lsl_zpzi_s, gen_helper_sve_lsl_zpzi_d,
      };
 -    if (a->esz < 0) {
 -        return false;
 -    }
 -    /* Shift by element size is architecturally valid.
 -       For logical shifts, it is a zeroing operation.  */
 -    if (a->imm >= (8 << a->esz)) {
 -        return do_movz_zpz(s, a->rd, a->rd, a->pg, a->esz, true);
 -    } else {
 -        return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
 -    }
 +    return do_shift_zpzi(s, a, false, fns);
  }
  static bool trans_ASRD(DisasContext *s, arg_rpri_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_ASRD(DisasContext *s, arg_rpri_esz *a)
          gen_helper_sve_asrd_b, gen_helper_sve_asrd_h,
          gen_helper_sve_asrd_s, gen_helper_sve_asrd_d,
      };
 -    if (a->esz < 0) {
 -        return false;
 -    }
 -    /* Shift by element size is architecturally valid.  For arithmetic
 -       right shift for division, it is a zeroing operation.  */
 -    if (a->imm >= (8 << a->esz)) {
 -        return do_movz_zpz(s, a->rd, a->rd, a->pg, a->esz, true);
 -    } else {
 -        return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
 -    }
 +    return do_shift_zpzi(s, a, false, fns);
  }
  static gen_helper_gvec_3 * const sqshl_zpzi_fns[4] = {
 --
-.19.1
+.25.1

-New patch
+[PULL 049/117] target/arm: Use TRANS_FEAT for do_shift_zpzi
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-47-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 52 +++++++++++++++-----------------------
+file changed, 20 insertions(+), 32 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_shift_zpzi(DisasContext *s, arg_rpri_esz *a, bool asr,
+     return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
+ }
+-static bool trans_ASR_zpzi(DisasContext *s, arg_rpri_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve_asr_zpzi_b, gen_helper_sve_asr_zpzi_h,
+-        gen_helper_sve_asr_zpzi_s, gen_helper_sve_asr_zpzi_d,
+-    };
+-    return do_shift_zpzi(s, a, true, fns);
+-}
++static gen_helper_gvec_3 * const asr_zpzi_fns[4] = {
++    gen_helper_sve_asr_zpzi_b, gen_helper_sve_asr_zpzi_h,
++    gen_helper_sve_asr_zpzi_s, gen_helper_sve_asr_zpzi_d,
++};
++TRANS_FEAT(ASR_zpzi, aa64_sve, do_shift_zpzi, a, true, asr_zpzi_fns)
+-static bool trans_LSR_zpzi(DisasContext *s, arg_rpri_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve_lsr_zpzi_b, gen_helper_sve_lsr_zpzi_h,
+-        gen_helper_sve_lsr_zpzi_s, gen_helper_sve_lsr_zpzi_d,
+-    };
+-    return do_shift_zpzi(s, a, false, fns);
+-}
++static gen_helper_gvec_3 * const lsr_zpzi_fns[4] = {
++    gen_helper_sve_lsr_zpzi_b, gen_helper_sve_lsr_zpzi_h,
++    gen_helper_sve_lsr_zpzi_s, gen_helper_sve_lsr_zpzi_d,
++};
++TRANS_FEAT(LSR_zpzi, aa64_sve, do_shift_zpzi, a, false, lsr_zpzi_fns)
+-static bool trans_LSL_zpzi(DisasContext *s, arg_rpri_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve_lsl_zpzi_b, gen_helper_sve_lsl_zpzi_h,
+-        gen_helper_sve_lsl_zpzi_s, gen_helper_sve_lsl_zpzi_d,
+-    };
+-    return do_shift_zpzi(s, a, false, fns);
+-}
++static gen_helper_gvec_3 * const lsl_zpzi_fns[4] = {
++    gen_helper_sve_lsl_zpzi_b, gen_helper_sve_lsl_zpzi_h,
++    gen_helper_sve_lsl_zpzi_s, gen_helper_sve_lsl_zpzi_d,
++};
++TRANS_FEAT(LSL_zpzi, aa64_sve, do_shift_zpzi, a, false, lsl_zpzi_fns)
+-static bool trans_ASRD(DisasContext *s, arg_rpri_esz *a)
+-{
+-    static gen_helper_gvec_3 * const fns[4] = {
+-        gen_helper_sve_asrd_b, gen_helper_sve_asrd_h,
+-        gen_helper_sve_asrd_s, gen_helper_sve_asrd_d,
+-    };
+-    return do_shift_zpzi(s, a, false, fns);
+-}
++static gen_helper_gvec_3 * const asrd_fns[4] = {
++    gen_helper_sve_asrd_b, gen_helper_sve_asrd_h,
++    gen_helper_sve_asrd_s, gen_helper_sve_asrd_d,
++};
++TRANS_FEAT(ASRD, aa64_sve, do_shift_zpzi, a, false, asrd_fns)
+ static gen_helper_gvec_3 * const sqshl_zpzi_fns[4] = {
+     gen_helper_sve2_sqshl_zpzi_b, gen_helper_sve2_sqshl_zpzi_h,
+--
+.25.1

-New patch
+[PULL 050/117] target/arm: Use TRANS_FEAT for do_zpzzz_ool
+From: Richard Henderson <richard.henderson@linaro.org>
+Remove the DO_ZPZZZ macro, as it had just the two uses.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-48-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 23 ++++++++++-------------
+file changed, 10 insertions(+), 13 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_zpzzz_ool(DisasContext *s, arg_rprrr_esz *a,
+     return true;
+ }
+-#define DO_ZPZZZ(NAME, name) \
+-static bool trans_##NAME(DisasContext *s, arg_rprrr_esz *a)          \
+-{                                                                    \
+-    static gen_helper_gvec_5 * const fns[4] = {                      \
+-        gen_helper_sve_##name##_b, gen_helper_sve_##name##_h,        \
+-        gen_helper_sve_##name##_s, gen_helper_sve_##name##_d,        \
+-    };                                                               \
+-    return do_zpzzz_ool(s, a, fns[a->esz]);                          \
+-}
++static gen_helper_gvec_5 * const mla_fns[4] = {
++    gen_helper_sve_mla_b, gen_helper_sve_mla_h,
++    gen_helper_sve_mla_s, gen_helper_sve_mla_d,
++};
++TRANS_FEAT(MLA, aa64_sve, do_zpzzz_ool, a, mla_fns[a->esz])
+-DO_ZPZZZ(MLA, mla)
+-DO_ZPZZZ(MLS, mls)
+-
+-#undef DO_ZPZZZ
++static gen_helper_gvec_5 * const mls_fns[4] = {
++    gen_helper_sve_mls_b, gen_helper_sve_mls_h,
++    gen_helper_sve_mls_s, gen_helper_sve_mls_d,
++};
++TRANS_FEAT(MLS, aa64_sve, do_zpzzz_ool, a, mls_fns[a->esz])
+ /*
+  *** SVE Index Generation Group
+--
+.25.1

-New patch
+[PULL 051/117] target/arm: Move sve check into do_index
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-49-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 53 ++++++++++++++++++--------------------
+file changed, 25 insertions(+), 28 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(MLS, aa64_sve, do_zpzzz_ool, a, mls_fns[a->esz])
+  *** SVE Index Generation Group
+  */
+-static void do_index(DisasContext *s, int esz, int rd,
++static bool do_index(DisasContext *s, int esz, int rd,
+                      TCGv_i64 start, TCGv_i64 incr)
+ {
+-    unsigned vsz = vec_full_reg_size(s);
+-    TCGv_i32 desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
+-    TCGv_ptr t_zd = tcg_temp_new_ptr();
++    unsigned vsz;
++    TCGv_i32 desc;
++    TCGv_ptr t_zd;
++
++    if (!sve_access_check(s)) {
++        return true;
++    }
++
++    vsz = vec_full_reg_size(s);
++    desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
++    t_zd = tcg_temp_new_ptr();
+     tcg_gen_addi_ptr(t_zd, cpu_env, vec_full_reg_offset(s, rd));
+     if (esz == 3) {
+@@ -XXX,XX +XXX,XX @@ static void do_index(DisasContext *s, int esz, int rd,
+         tcg_temp_free_i32(i32);
+     }
+     tcg_temp_free_ptr(t_zd);
++    return true;
+ }
+ static bool trans_INDEX_ii(DisasContext *s, arg_INDEX_ii *a)
+ {
+-    if (sve_access_check(s)) {
+-        TCGv_i64 start = tcg_constant_i64(a->imm1);
+-        TCGv_i64 incr = tcg_constant_i64(a->imm2);
+-        do_index(s, a->esz, a->rd, start, incr);
+-    }
+-    return true;
++    TCGv_i64 start = tcg_constant_i64(a->imm1);
++    TCGv_i64 incr = tcg_constant_i64(a->imm2);
++    return do_index(s, a->esz, a->rd, start, incr);
+ }
+ static bool trans_INDEX_ir(DisasContext *s, arg_INDEX_ir *a)
+ {
+-    if (sve_access_check(s)) {
+-        TCGv_i64 start = tcg_constant_i64(a->imm);
+-        TCGv_i64 incr = cpu_reg(s, a->rm);
+-        do_index(s, a->esz, a->rd, start, incr);
+-    }
+-    return true;
++    TCGv_i64 start = tcg_constant_i64(a->imm);
++    TCGv_i64 incr = cpu_reg(s, a->rm);
++    return do_index(s, a->esz, a->rd, start, incr);
+ }
+ static bool trans_INDEX_ri(DisasContext *s, arg_INDEX_ri *a)
+ {
+-    if (sve_access_check(s)) {
+-        TCGv_i64 start = cpu_reg(s, a->rn);
+-        TCGv_i64 incr = tcg_constant_i64(a->imm);
+-        do_index(s, a->esz, a->rd, start, incr);
+-    }
+-    return true;
++    TCGv_i64 start = cpu_reg(s, a->rn);
++    TCGv_i64 incr = tcg_constant_i64(a->imm);
++    return do_index(s, a->esz, a->rd, start, incr);
+ }
+ static bool trans_INDEX_rr(DisasContext *s, arg_INDEX_rr *a)
+ {
+-    if (sve_access_check(s)) {
+-        TCGv_i64 start = cpu_reg(s, a->rn);
+-        TCGv_i64 incr = cpu_reg(s, a->rm);
+-        do_index(s, a->esz, a->rd, start, incr);
+-    }
+-    return true;
++    TCGv_i64 start = cpu_reg(s, a->rn);
++    TCGv_i64 incr = cpu_reg(s, a->rm);
++    return do_index(s, a->esz, a->rd, start, incr);
+ }
+ /*
+--
+.25.1

-New patch
+[PULL 052/117] target/arm: Use TRANS_FEAT for do_index
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-50-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 35 ++++++++---------------------------
+file changed, 8 insertions(+), 27 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_index(DisasContext *s, int esz, int rd,
+     return true;
+ }
+-static bool trans_INDEX_ii(DisasContext *s, arg_INDEX_ii *a)
+-{
+-    TCGv_i64 start = tcg_constant_i64(a->imm1);
+-    TCGv_i64 incr = tcg_constant_i64(a->imm2);
+-    return do_index(s, a->esz, a->rd, start, incr);
+-}
+-
+-static bool trans_INDEX_ir(DisasContext *s, arg_INDEX_ir *a)
+-{
+-    TCGv_i64 start = tcg_constant_i64(a->imm);
+-    TCGv_i64 incr = cpu_reg(s, a->rm);
+-    return do_index(s, a->esz, a->rd, start, incr);
+-}
+-
+-static bool trans_INDEX_ri(DisasContext *s, arg_INDEX_ri *a)
+-{
+-    TCGv_i64 start = cpu_reg(s, a->rn);
+-    TCGv_i64 incr = tcg_constant_i64(a->imm);
+-    return do_index(s, a->esz, a->rd, start, incr);
+-}
+-
+-static bool trans_INDEX_rr(DisasContext *s, arg_INDEX_rr *a)
+-{
+-    TCGv_i64 start = cpu_reg(s, a->rn);
+-    TCGv_i64 incr = cpu_reg(s, a->rm);
+-    return do_index(s, a->esz, a->rd, start, incr);
+-}
++TRANS_FEAT(INDEX_ii, aa64_sve, do_index, a->esz, a->rd,
++           tcg_constant_i64(a->imm1), tcg_constant_i64(a->imm2))
++TRANS_FEAT(INDEX_ir, aa64_sve, do_index, a->esz, a->rd,
++           tcg_constant_i64(a->imm), cpu_reg(s, a->rm))
++TRANS_FEAT(INDEX_ri, aa64_sve, do_index, a->esz, a->rd,
++           cpu_reg(s, a->rn), tcg_constant_i64(a->imm))
++TRANS_FEAT(INDEX_rr, aa64_sve, do_index, a->esz, a->rd,
++           cpu_reg(s, a->rn), cpu_reg(s, a->rm))
+ /*
+  *** SVE Stack Allocation Group
+--
+.25.1

-New patch
+[PULL 053/117] target/arm: Use TRANS_FEAT for do_adr
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-51-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 23 ++++-------------------
+file changed, 4 insertions(+), 19 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_adr(DisasContext *s, arg_rrri *a, gen_helper_gvec_3 *fn)
+     return gen_gvec_ool_zzz(s, fn, a->rd, a->rn, a->rm, a->imm);
+ }
+-static bool trans_ADR_p32(DisasContext *s, arg_rrri *a)
+-{
+-    return do_adr(s, a, gen_helper_sve_adr_p32);
+-}
+-
+-static bool trans_ADR_p64(DisasContext *s, arg_rrri *a)
+-{
+-    return do_adr(s, a, gen_helper_sve_adr_p64);
+-}
+-
+-static bool trans_ADR_s32(DisasContext *s, arg_rrri *a)
+-{
+-    return do_adr(s, a, gen_helper_sve_adr_s32);
+-}
+-
+-static bool trans_ADR_u32(DisasContext *s, arg_rrri *a)
+-{
+-    return do_adr(s, a, gen_helper_sve_adr_u32);
+-}
++TRANS_FEAT(ADR_p32, aa64_sve, do_adr, a, gen_helper_sve_adr_p32)
++TRANS_FEAT(ADR_p64, aa64_sve, do_adr, a, gen_helper_sve_adr_p64)
++TRANS_FEAT(ADR_s32, aa64_sve, do_adr, a, gen_helper_sve_adr_s32)
++TRANS_FEAT(ADR_u32, aa64_sve, do_adr, a, gen_helper_sve_adr_u32)
+ /*
+  *** SVE Integer Misc - Unpredicated Group
+--
+.25.1

-New patch
+[PULL 054/117] target/arm: Use TRANS_FEAT for do_predset
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-52-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 19 +++++--------------
+file changed, 5 insertions(+), 14 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_predset(DisasContext *s, int esz, int rd, int pat, bool setflag)
+     return true;
+ }
+-static bool trans_PTRUE(DisasContext *s, arg_PTRUE *a)
+-{
+-    return do_predset(s, a->esz, a->rd, a->pat, a->s);
+-}
++TRANS_FEAT(PTRUE, aa64_sve, do_predset, a->esz, a->rd, a->pat, a->s)
+-static bool trans_SETFFR(DisasContext *s, arg_SETFFR *a)
+-{
+-    /* Note pat == 31 is #all, to set all elements.  */
+-    return do_predset(s, 0, FFR_PRED_NUM, 31, false);
+-}
++/* Note pat == 31 is #all, to set all elements.  */
++TRANS_FEAT(SETFFR, aa64_sve, do_predset, 0, FFR_PRED_NUM, 31, false)
+-static bool trans_PFALSE(DisasContext *s, arg_PFALSE *a)
+-{
+-    /* Note pat == 32 is #unimp, to set no elements.  */
+-    return do_predset(s, 0, a->rd, 32, false);
+-}
++/* Note pat == 32 is #unimp, to set no elements.  */
++TRANS_FEAT(PFALSE, aa64_sve, do_predset, 0, a->rd, 32, false)
+ static bool trans_RDFFR_p(DisasContext *s, arg_RDFFR_p *a)
+ {
+--
+.25.1

-New patch
+[PULL 055/117] target/arm: Use TRANS_FEAT for RDFFR, WRFFR
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-53-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 11 ++---------
+file changed, 2 insertions(+), 9 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool trans_RDFFR_p(DisasContext *s, arg_RDFFR_p *a)
+     return trans_AND_pppp(s, &alt_a);
+ }
+-static bool trans_RDFFR(DisasContext *s, arg_RDFFR *a)
+-{
+-    return do_mov_p(s, a->rd, FFR_PRED_NUM);
+-}
+-
+-static bool trans_WRFFR(DisasContext *s, arg_WRFFR *a)
+-{
+-    return do_mov_p(s, FFR_PRED_NUM, a->rn);
+-}
++TRANS_FEAT(RDFFR, aa64_sve, do_mov_p, a->rd, FFR_PRED_NUM)
++TRANS_FEAT(WRFFR, aa64_sve, do_mov_p, FFR_PRED_NUM, a->rn)
+ static bool do_pfirst_pnext(DisasContext *s, arg_rr_esz *a,
+                             void (*gen_fn)(TCGv_i32, TCGv_ptr,
+--
+.25.1

-New patch
+[PULL 056/117] target/arm: Use TRANS_FEAT for do_pfirst_pnext
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-54-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 11 ++---------
+file changed, 2 insertions(+), 9 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_pfirst_pnext(DisasContext *s, arg_rr_esz *a,
+     return true;
+ }
+-static bool trans_PFIRST(DisasContext *s, arg_rr_esz *a)
+-{
+-    return do_pfirst_pnext(s, a, gen_helper_sve_pfirst);
+-}
+-
+-static bool trans_PNEXT(DisasContext *s, arg_rr_esz *a)
+-{
+-    return do_pfirst_pnext(s, a, gen_helper_sve_pnext);
+-}
++TRANS_FEAT(PFIRST, aa64_sve, do_pfirst_pnext, a, gen_helper_sve_pfirst)
++TRANS_FEAT(PNEXT, aa64_sve, do_pfirst_pnext, a, gen_helper_sve_pnext)
+ /*
+  *** SVE Element Count Group
+--
+.25.1

-New patch
+[PULL 057/117] target/arm: Use TRANS_FEAT for do_EXT
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-55-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 14 ++------------
+file changed, 2 insertions(+), 12 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_EXT(DisasContext *s, int rd, int rn, int rm, int imm)
+     return true;
+ }
+-static bool trans_EXT(DisasContext *s, arg_EXT *a)
+-{
+-    return do_EXT(s, a->rd, a->rn, a->rm, a->imm);
+-}
+-
+-static bool trans_EXT_sve2(DisasContext *s, arg_rri *a)
+-{
+-    if (!dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    return do_EXT(s, a->rd, a->rn, (a->rn + 1) % 32, a->imm);
+-}
++TRANS_FEAT(EXT, aa64_sve, do_EXT, a->rd, a->rn, a->rm, a->imm)
++TRANS_FEAT(EXT_sve2, aa64_sve2, do_EXT, a->rd, a->rn, (a->rn + 1) % 32, a->imm)
+ /*
+  *** SVE Permute - Unpredicated Group
+--
+.25.1

-New patch
+[PULL 058/117] target/arm: Use TRANS_FEAT for do_perm_pred3
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-56-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 35 ++++++-----------------------------
+file changed, 6 insertions(+), 29 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_perm_pred2(DisasContext *s, arg_rr_esz *a, bool high_odd,
+     return true;
+ }
+-static bool trans_ZIP1_p(DisasContext *s, arg_rrr_esz *a)
+-{
+-    return do_perm_pred3(s, a, 0, gen_helper_sve_zip_p);
+-}
+-
+-static bool trans_ZIP2_p(DisasContext *s, arg_rrr_esz *a)
+-{
+-    return do_perm_pred3(s, a, 1, gen_helper_sve_zip_p);
+-}
+-
+-static bool trans_UZP1_p(DisasContext *s, arg_rrr_esz *a)
+-{
+-    return do_perm_pred3(s, a, 0, gen_helper_sve_uzp_p);
+-}
+-
+-static bool trans_UZP2_p(DisasContext *s, arg_rrr_esz *a)
+-{
+-    return do_perm_pred3(s, a, 1, gen_helper_sve_uzp_p);
+-}
+-
+-static bool trans_TRN1_p(DisasContext *s, arg_rrr_esz *a)
+-{
+-    return do_perm_pred3(s, a, 0, gen_helper_sve_trn_p);
+-}
+-
+-static bool trans_TRN2_p(DisasContext *s, arg_rrr_esz *a)
+-{
+-    return do_perm_pred3(s, a, 1, gen_helper_sve_trn_p);
+-}
++TRANS_FEAT(ZIP1_p, aa64_sve, do_perm_pred3, a, 0, gen_helper_sve_zip_p)
++TRANS_FEAT(ZIP2_p, aa64_sve, do_perm_pred3, a, 1, gen_helper_sve_zip_p)
++TRANS_FEAT(UZP1_p, aa64_sve, do_perm_pred3, a, 0, gen_helper_sve_uzp_p)
++TRANS_FEAT(UZP2_p, aa64_sve, do_perm_pred3, a, 1, gen_helper_sve_uzp_p)
++TRANS_FEAT(TRN1_p, aa64_sve, do_perm_pred3, a, 0, gen_helper_sve_trn_p)
++TRANS_FEAT(TRN2_p, aa64_sve, do_perm_pred3, a, 1, gen_helper_sve_trn_p)
+ static bool trans_REV_p(DisasContext *s, arg_rr_esz *a)
+ {
+--
+.25.1

-New patch
+[PULL 059/117] target/arm: Use TRANS_FEAT for do_perm_pred2
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-57-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 17 +++--------------
+file changed, 3 insertions(+), 14 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(UZP2_p, aa64_sve, do_perm_pred3, a, 1, gen_helper_sve_uzp_p)
+ TRANS_FEAT(TRN1_p, aa64_sve, do_perm_pred3, a, 0, gen_helper_sve_trn_p)
+ TRANS_FEAT(TRN2_p, aa64_sve, do_perm_pred3, a, 1, gen_helper_sve_trn_p)
+-static bool trans_REV_p(DisasContext *s, arg_rr_esz *a)
+-{
+-    return do_perm_pred2(s, a, 0, gen_helper_sve_rev_p);
+-}
+-
+-static bool trans_PUNPKLO(DisasContext *s, arg_PUNPKLO *a)
+-{
+-    return do_perm_pred2(s, a, 0, gen_helper_sve_punpk_p);
+-}
+-
+-static bool trans_PUNPKHI(DisasContext *s, arg_PUNPKHI *a)
+-{
+-    return do_perm_pred2(s, a, 1, gen_helper_sve_punpk_p);
+-}
++TRANS_FEAT(REV_p, aa64_sve, do_perm_pred2, a, 0, gen_helper_sve_rev_p)
++TRANS_FEAT(PUNPKLO, aa64_sve, do_perm_pred2, a, 0, gen_helper_sve_punpk_p)
++TRANS_FEAT(PUNPKHI, aa64_sve, do_perm_pred2, a, 1, gen_helper_sve_punpk_p)
+ /*
+  *** SVE Permute - Interleaving Group
+--
+.25.1

-[Qemu-devel] [PULL 15/45] target/arm: ISR_EL1 bits track virtual interrupts if IMO/FMO set
+[PULL 060/117] target/arm: Move sve zip high_ofs into simd_data
-The A/I/F bits in ISR_EL1 should track the virtual interrupt
+From: Richard Henderson <richard.henderson@linaro.org>
 status, not the physical interrupt status, if the associated
 HCR_EL2.AMO/IMO/FMO bit is set. Implement this, rather than
 always showing the physical interrupt status.
-We don't currently implement anything to do with external
+This is in line with how we treat uzp, and will
-aborts, so this applies only to the I and F bits (though it
+eliminate the special case code during translation.
 ought to be possible for the outer guest to present a virtual
 external abort to the inner guest, even if QEMU doesn't
 emulate physical external aborts, so there is missing
 functionality in this area).
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-58-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181012144235.19646-6-peter.maydell@linaro.org
 ---
- target/arm/helper.c | 22 ++++++++++++++++++----
+ target/arm/sve_helper.c    |  6 ++++--
-file changed, 18 insertions(+), 4 deletions(-)
+ target/arm/translate-sve.c | 12 ++++++------
 files changed, 10 insertions(+), 8 deletions(-)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/target/arm/sve_helper.c
-+++ b/target/arm/helper.c
++++ b/target/arm/sve_helper.c
-@@ -XXX,XX +XXX,XX @@ static uint64_t isr_read(CPUARMState *env, const ARMCPRegInfo *ri)
+@@ -XXX,XX +XXX,XX @@ void HELPER(sve_punpk_p)(void *vd, void *vn, uint32_t pred_desc)
-     CPUState *cs = ENV_GET_CPU(env);
+ void HELPER(NAME)(void *vd, void *vn, void *vm, uint32_t desc)       \
-     uint64_t ret = 0;
+ {                                                                    \
+     intptr_t oprsz = simd_oprsz(desc);                               \
--    if (cs->interrupt_request & CPU_INTERRUPT_HARD) {
++    intptr_t odd_ofs = simd_data(desc);                              \
--        ret |= CPSR_I;
+     intptr_t i, oprsz_2 = oprsz / 2;                                 \
-+    if (arm_hcr_el2_imo(env)) {
+     ARMVectorReg tmp_n, tmp_m;                                       \
-+        if (cs->interrupt_request & CPU_INTERRUPT_VIRQ) {
+     /* We produce output faster than we consume input.               \
-+            ret |= CPSR_I;
+@@ -XXX,XX +XXX,XX @@ void HELPER(NAME)(void *vd, void *vn, void *vm, uint32_t desc)       \
-+        }
+         vm = memcpy(&tmp_m, vm, oprsz_2);                            \
-+    } else {
+     }                                                                \
-+        if (cs->interrupt_request & CPU_INTERRUPT_HARD) {
+     for (i = 0; i < oprsz_2; i += sizeof(TYPE)) {                    \
-+            ret |= CPSR_I;
+-        *(TYPE *)(vd + H(2 * i + 0)) = *(TYPE *)(vn + H(i));         \
-+        }
+-        *(TYPE *)(vd + H(2 * i + sizeof(TYPE))) = *(TYPE *)(vm + H(i)); \
 +        *(TYPE *)(vd + H(2 * i + 0)) = *(TYPE *)(vn + odd_ofs + H(i)); \
 +        *(TYPE *)(vd + H(2 * i + sizeof(TYPE))) =                    \
 +            *(TYPE *)(vm + odd_ofs + H(i));                          \
      }                                                                \
      if (sizeof(TYPE) == 16 && unlikely(oprsz & 16)) {                \
          memset(vd + oprsz - 16, 0, 16);                              \
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-sve.c
 +++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_zip(DisasContext *s, arg_rrr_esz *a, bool high)
          unsigned vsz = vec_full_reg_size(s);
          unsigned high_ofs = high ? vsz / 2 : 0;
          tcg_gen_gvec_3_ool(vec_full_reg_offset(s, a->rd),
 -                           vec_full_reg_offset(s, a->rn) + high_ofs,
 -                           vec_full_reg_offset(s, a->rm) + high_ofs,
 -                           vsz, vsz, 0, fns[a->esz]);
 +                           vec_full_reg_offset(s, a->rn),
 +                           vec_full_reg_offset(s, a->rm),
 +                           vsz, vsz, high_ofs, fns[a->esz]);
      }
--    if (cs->interrupt_request & CPU_INTERRUPT_FIQ) {
+     return true;
--        ret |= CPSR_F;
+ }
-+
+@@ -XXX,XX +XXX,XX @@ static bool do_zip_q(DisasContext *s, arg_rrr_esz *a, bool high)
-+    if (arm_hcr_el2_fmo(env)) {
+         unsigned vsz = vec_full_reg_size(s);
-+        if (cs->interrupt_request & CPU_INTERRUPT_VFIQ) {
+         unsigned high_ofs = high ? QEMU_ALIGN_DOWN(vsz, 32) / 2 : 0;
-+            ret |= CPSR_F;
+         tcg_gen_gvec_3_ool(vec_full_reg_offset(s, a->rd),
-+        }
+-                           vec_full_reg_offset(s, a->rn) + high_ofs,
-+    } else {
+-                           vec_full_reg_offset(s, a->rm) + high_ofs,
-+        if (cs->interrupt_request & CPU_INTERRUPT_FIQ) {
+-                           vsz, vsz, 0, gen_helper_sve2_zip_q);
-+            ret |= CPSR_F;
++                           vec_full_reg_offset(s, a->rn),
-+        }
++                           vec_full_reg_offset(s, a->rm),
 +                           vsz, vsz, high_ofs, gen_helper_sve2_zip_q);
      }
-+
+     return true;
      /* External aborts are not possible in QEMU so A bit is always clear */
      return ret;
  }
 --
-.19.1
+.25.1

-New patch
+[PULL 061/117] target/arm: Use gen_gvec_ool_arg_zzz for do_zip, do_zip_q
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-59-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 25 +++++++------------------
+file changed, 7 insertions(+), 18 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_zip(DisasContext *s, arg_rrr_esz *a, bool high)
+         gen_helper_sve_zip_b, gen_helper_sve_zip_h,
+         gen_helper_sve_zip_s, gen_helper_sve_zip_d,
+     };
++    unsigned vsz = vec_full_reg_size(s);
++    unsigned high_ofs = high ? vsz / 2 : 0;
+-    if (sve_access_check(s)) {
+-        unsigned vsz = vec_full_reg_size(s);
+-        unsigned high_ofs = high ? vsz / 2 : 0;
+-        tcg_gen_gvec_3_ool(vec_full_reg_offset(s, a->rd),
+-                           vec_full_reg_offset(s, a->rn),
+-                           vec_full_reg_offset(s, a->rm),
+-                           vsz, vsz, high_ofs, fns[a->esz]);
+-    }
+-    return true;
++    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, high_ofs);
+ }
+ static bool trans_ZIP1_z(DisasContext *s, arg_rrr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_ZIP2_z(DisasContext *s, arg_rrr_esz *a)
+ static bool do_zip_q(DisasContext *s, arg_rrr_esz *a, bool high)
+ {
++    unsigned vsz = vec_full_reg_size(s);
++    unsigned high_ofs = high ? QEMU_ALIGN_DOWN(vsz, 32) / 2 : 0;
++
+     if (!dc_isar_feature(aa64_sve_f64mm, s)) {
+         return false;
+     }
+-    if (sve_access_check(s)) {
+-        unsigned vsz = vec_full_reg_size(s);
+-        unsigned high_ofs = high ? QEMU_ALIGN_DOWN(vsz, 32) / 2 : 0;
+-        tcg_gen_gvec_3_ool(vec_full_reg_offset(s, a->rd),
+-                           vec_full_reg_offset(s, a->rn),
+-                           vec_full_reg_offset(s, a->rm),
+-                           vsz, vsz, high_ofs, gen_helper_sve2_zip_q);
+-    }
+-    return true;
++    return gen_gvec_ool_arg_zzz(s, gen_helper_sve2_zip_q, a, high_ofs);
+ }
+ static bool trans_ZIP1_q(DisasContext *s, arg_rrr_esz *a)
+--
+.25.1

-[Qemu-devel] [PULL 34/45] target/arm: Use gvec for VSRA
+[PULL 062/117] target/arm: Use TRANS_FEAT for do_zip, do_zip_q
 From: Richard Henderson <richard.henderson@linaro.org>
-Move ssra_op and usra_op expanders from translate-a64.c.
+Convert SVE translation functions using do_zip*
 to use TRANS_FEAT and gen_gvec_ool_arg_zzz.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-14-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-60-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.h     |   2 +
+ target/arm/translate-sve.c | 54 +++++++++-----------------------------
- target/arm/translate-a64.c | 106 ----------------------------
+file changed, 13 insertions(+), 41 deletions(-)
  target/arm/translate.c     | 139 ++++++++++++++++++++++++++++++++++---
 files changed, 130 insertions(+), 117 deletions(-)
-diff --git a/target/arm/translate.h b/target/arm/translate.h
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static inline TCGv_i32 get_ahp_flag(void)
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(PUNPKHI, aa64_sve, do_perm_pred2, a, 1, gen_helper_sve_punpk_p)
- extern const GVecGen3 bsl_op;
+  *** SVE Permute - Interleaving Group
- extern const GVecGen3 bit_op;
+  */
- extern const GVecGen3 bif_op;
-+extern const GVecGen2i ssra_op[4];
+-static bool do_zip(DisasContext *s, arg_rrr_esz *a, bool high)
 +extern const GVecGen2i usra_op[4];
  /*
   * Forward to the isar_feature_* tests given a DisasContext pointer.
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_two_reg_misc(DisasContext *s, uint32_t insn)
      }
  }
 -static void gen_ssra8_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 -{
--    tcg_gen_vec_sar8i_i64(a, a, shift);
+-    static gen_helper_gvec_3 * const fns[4] = {
--    tcg_gen_vec_add8_i64(d, d, a);
+-        gen_helper_sve_zip_b, gen_helper_sve_zip_h,
 -        gen_helper_sve_zip_s, gen_helper_sve_zip_d,
 -    };
 -    unsigned vsz = vec_full_reg_size(s);
 -    unsigned high_ofs = high ? vsz / 2 : 0;
 +static gen_helper_gvec_3 * const zip_fns[4] = {
 +    gen_helper_sve_zip_b, gen_helper_sve_zip_h,
 +    gen_helper_sve_zip_s, gen_helper_sve_zip_d,
 +};
 +TRANS_FEAT(ZIP1_z, aa64_sve, gen_gvec_ool_arg_zzz,
 +           zip_fns[a->esz], a, 0)
 +TRANS_FEAT(ZIP2_z, aa64_sve, gen_gvec_ool_arg_zzz,
 +           zip_fns[a->esz], a, vec_full_reg_size(s) / 2)
 -    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, high_ofs);
 -}
 -
--static void gen_ssra16_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+-static bool trans_ZIP1_z(DisasContext *s, arg_rrr_esz *a)
 -{
--    tcg_gen_vec_sar16i_i64(a, a, shift);
+-    return do_zip(s, a, false);
 -    tcg_gen_vec_add16_i64(d, d, a);
 -}
 -
--static void gen_ssra32_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
+-static bool trans_ZIP2_z(DisasContext *s, arg_rrr_esz *a)
 -{
--    tcg_gen_sari_i32(a, a, shift);
+-    return do_zip(s, a, true);
 -    tcg_gen_add_i32(d, d, a);
 -}
 -
--static void gen_ssra64_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+-static bool do_zip_q(DisasContext *s, arg_rrr_esz *a, bool high)
 -{
--    tcg_gen_sari_i64(a, a, shift);
+-    unsigned vsz = vec_full_reg_size(s);
--    tcg_gen_add_i64(d, d, a);
+-    unsigned high_ofs = high ? QEMU_ALIGN_DOWN(vsz, 32) / 2 : 0;
 -
 -    if (!dc_isar_feature(aa64_sve_f64mm, s)) {
 -        return false;
 -    }
 -    return gen_gvec_ool_arg_zzz(s, gen_helper_sve2_zip_q, a, high_ofs);
 -}
 -
--static void gen_ssra_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
+-static bool trans_ZIP1_q(DisasContext *s, arg_rrr_esz *a)
 -{
--    tcg_gen_sari_vec(vece, a, a, sh);
+-    return do_zip_q(s, a, false);
 -    tcg_gen_add_vec(vece, d, d, a);
 -}
 -
--static void gen_usra8_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+-static bool trans_ZIP2_q(DisasContext *s, arg_rrr_esz *a)
 -{
--    tcg_gen_vec_shr8i_i64(a, a, shift);
+-    return do_zip_q(s, a, true);
 -    tcg_gen_vec_add8_i64(d, d, a);
 -}
--
++TRANS_FEAT(ZIP1_q, aa64_sve_f64mm, gen_gvec_ool_arg_zzz,
--static void gen_usra16_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
++           gen_helper_sve2_zip_q, a, 0)
--{
++TRANS_FEAT(ZIP2_q, aa64_sve_f64mm, gen_gvec_ool_arg_zzz,
--    tcg_gen_vec_shr16i_i64(a, a, shift);
++           gen_helper_sve2_zip_q, a,
--    tcg_gen_vec_add16_i64(d, d, a);
++           QEMU_ALIGN_DOWN(vec_full_reg_size(s), 32) / 2)
--}
--
+ static gen_helper_gvec_3 * const uzp_fns[4] = {
--static void gen_usra32_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
+     gen_helper_sve_uzp_b, gen_helper_sve_uzp_h,
 -{
 -    tcg_gen_shri_i32(a, a, shift);
 -    tcg_gen_add_i32(d, d, a);
 -}
 -
 -static void gen_usra64_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 -{
 -    tcg_gen_shri_i64(a, a, shift);
 -    tcg_gen_add_i64(d, d, a);
 -}
 -
 -static void gen_usra_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
 -{
 -    tcg_gen_shri_vec(vece, a, a, sh);
 -    tcg_gen_add_vec(vece, d, d, a);
 -}
 -
  static void gen_shr8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
  {
      uint64_t mask = dup_const(MO_8, 0xff >> shift);
@@ -XXX,XX +XXX,XX @@ static void gen_shr_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
  static void handle_vec_simd_shri(DisasContext *s, bool is_q, bool is_u,
                                   int immh, int immb, int opcode, int rn, int rd)
  {
 -    static const GVecGen2i ssra_op[4] = {
 -        { .fni8 = gen_ssra8_i64,
 -          .fniv = gen_ssra_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_sari_vec,
 -          .vece = MO_8 },
 -        { .fni8 = gen_ssra16_i64,
 -          .fniv = gen_ssra_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_sari_vec,
 -          .vece = MO_16 },
 -        { .fni4 = gen_ssra32_i32,
 -          .fniv = gen_ssra_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_sari_vec,
 -          .vece = MO_32 },
 -        { .fni8 = gen_ssra64_i64,
 -          .fniv = gen_ssra_vec,
 -          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -          .load_dest = true,
 -          .opc = INDEX_op_sari_vec,
 -          .vece = MO_64 },
 -    };
 -    static const GVecGen2i usra_op[4] = {
 -        { .fni8 = gen_usra8_i64,
 -          .fniv = gen_usra_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_shri_vec,
 -          .vece = MO_8, },
 -        { .fni8 = gen_usra16_i64,
 -          .fniv = gen_usra_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_shri_vec,
 -          .vece = MO_16, },
 -        { .fni4 = gen_usra32_i32,
 -          .fniv = gen_usra_vec,
 -          .load_dest = true,
 -          .opc = INDEX_op_shri_vec,
 -          .vece = MO_32, },
 -        { .fni8 = gen_usra64_i64,
 -          .fniv = gen_usra_vec,
 -          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 -          .load_dest = true,
 -          .opc = INDEX_op_shri_vec,
 -          .vece = MO_64, },
 -    };
      static const GVecGen2i sri_op[4] = {
          { .fni8 = gen_shr8_ins_i64,
            .fniv = gen_shr_ins_vec,
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ const GVecGen3 bif_op = {
      .load_dest = true
  };
 +static void gen_ssra8_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    tcg_gen_vec_sar8i_i64(a, a, shift);
 +    tcg_gen_vec_add8_i64(d, d, a);
 +}
 +
 +static void gen_ssra16_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    tcg_gen_vec_sar16i_i64(a, a, shift);
 +    tcg_gen_vec_add16_i64(d, d, a);
 +}
 +
 +static void gen_ssra32_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
 +{
 +    tcg_gen_sari_i32(a, a, shift);
 +    tcg_gen_add_i32(d, d, a);
 +}
 +
 +static void gen_ssra64_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    tcg_gen_sari_i64(a, a, shift);
 +    tcg_gen_add_i64(d, d, a);
 +}
 +
 +static void gen_ssra_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
 +{
 +    tcg_gen_sari_vec(vece, a, a, sh);
 +    tcg_gen_add_vec(vece, d, d, a);
 +}
 +
 +const GVecGen2i ssra_op[4] = {
 +    { .fni8 = gen_ssra8_i64,
 +      .fniv = gen_ssra_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_sari_vec,
 +      .vece = MO_8 },
 +    { .fni8 = gen_ssra16_i64,
 +      .fniv = gen_ssra_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_sari_vec,
 +      .vece = MO_16 },
 +    { .fni4 = gen_ssra32_i32,
 +      .fniv = gen_ssra_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_sari_vec,
 +      .vece = MO_32 },
 +    { .fni8 = gen_ssra64_i64,
 +      .fniv = gen_ssra_vec,
 +      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 +      .load_dest = true,
 +      .opc = INDEX_op_sari_vec,
 +      .vece = MO_64 },
 +};
 +
 +static void gen_usra8_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    tcg_gen_vec_shr8i_i64(a, a, shift);
 +    tcg_gen_vec_add8_i64(d, d, a);
 +}
 +
 +static void gen_usra16_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    tcg_gen_vec_shr16i_i64(a, a, shift);
 +    tcg_gen_vec_add16_i64(d, d, a);
 +}
 +
 +static void gen_usra32_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
 +{
 +    tcg_gen_shri_i32(a, a, shift);
 +    tcg_gen_add_i32(d, d, a);
 +}
 +
 +static void gen_usra64_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
 +{
 +    tcg_gen_shri_i64(a, a, shift);
 +    tcg_gen_add_i64(d, d, a);
 +}
 +
 +static void gen_usra_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
 +{
 +    tcg_gen_shri_vec(vece, a, a, sh);
 +    tcg_gen_add_vec(vece, d, d, a);
 +}
 +
 +const GVecGen2i usra_op[4] = {
 +    { .fni8 = gen_usra8_i64,
 +      .fniv = gen_usra_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_shri_vec,
 +      .vece = MO_8, },
 +    { .fni8 = gen_usra16_i64,
 +      .fniv = gen_usra_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_shri_vec,
 +      .vece = MO_16, },
 +    { .fni4 = gen_usra32_i32,
 +      .fniv = gen_usra_vec,
 +      .load_dest = true,
 +      .opc = INDEX_op_shri_vec,
 +      .vece = MO_32, },
 +    { .fni8 = gen_usra64_i64,
 +      .fniv = gen_usra_vec,
 +      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
 +      .load_dest = true,
 +      .opc = INDEX_op_shri_vec,
 +      .vece = MO_64, },
 +};
  /* Translate a NEON data processing instruction.  Return nonzero if the
     instruction is invalid.
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                      }
                      return 0;
 +                case 1:  /* VSRA */
 +                    /* Right shift comes here negative.  */
 +                    shift = -shift;
 +                    /* Shifts larger than the element size are architecturally
 +                     * valid.  Unsigned results in all zeros; signed results
 +                     * in all sign bits.
 +                     */
 +                    if (!u) {
 +                        tcg_gen_gvec_2i(rd_ofs, rm_ofs, vec_size, vec_size,
 +                                        MIN(shift, (8 << size) - 1),
 +                                        &ssra_op[size]);
 +                    } else if (shift >= 8 << size) {
 +                        /* rd += 0 */
 +                    } else {
 +                        tcg_gen_gvec_2i(rd_ofs, rm_ofs, vec_size, vec_size,
 +                                        shift, &usra_op[size]);
 +                    }
 +                    return 0;
 +
                  case 5: /* VSHL, VSLI */
                      if (!u) { /* VSHL */
                          /* Shifts larger than the element size are
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                          neon_load_reg64(cpu_V0, rm + pass);
                          tcg_gen_movi_i64(cpu_V1, imm);
                          switch (op) {
 -                        case 1:  /* VSRA */
 -                            if (u)
 -                                gen_helper_neon_shl_u64(cpu_V0, cpu_V0, cpu_V1);
 -                            else
 -                                gen_helper_neon_shl_s64(cpu_V0, cpu_V0, cpu_V1);
 -                            break;
                          case 2: /* VRSHR */
                          case 3: /* VRSRA */
                              if (u)
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                          default:
                              g_assert_not_reached();
                          }
 -                        if (op == 1 || op == 3) {
 +                        if (op == 3) {
                              /* Accumulate.  */
                              neon_load_reg64(cpu_V1, rd + pass);
                              tcg_gen_add_i64(cpu_V0, cpu_V0, cpu_V1);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                          tmp2 = tcg_temp_new_i32();
                          tcg_gen_movi_i32(tmp2, imm);
                          switch (op) {
 -                        case 1:  /* VSRA */
 -                            GEN_NEON_INTEGER_OP(shl);
 -                            break;
                          case 2: /* VRSHR */
                          case 3: /* VRSRA */
                              GEN_NEON_INTEGER_OP(rshl);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                          }
                          tcg_temp_free_i32(tmp2);
 -                        if (op == 1 || op == 3) {
 +                        if (op == 3) {
                              /* Accumulate.  */
                              tmp2 = neon_load_reg(rd, pass);
                              gen_neon_add(size, tmp, tmp2);
 --
-.19.1
+.25.1

-New patch
+[PULL 063/117] target/arm: Use TRANS_FEAT for do_clast_vector
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-61-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 11 ++---------
+file changed, 2 insertions(+), 9 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_clast_vector(DisasContext *s, arg_rprr_esz *a, bool before)
+     return true;
+ }
+-static bool trans_CLASTA_z(DisasContext *s, arg_rprr_esz *a)
+-{
+-    return do_clast_vector(s, a, false);
+-}
+-
+-static bool trans_CLASTB_z(DisasContext *s, arg_rprr_esz *a)
+-{
+-    return do_clast_vector(s, a, true);
+-}
++TRANS_FEAT(CLASTA_z, aa64_sve, do_clast_vector, a, false)
++TRANS_FEAT(CLASTB_z, aa64_sve, do_clast_vector, a, true)
+ /* Compute CLAST for a scalar.  */
+ static void do_clast_scalar(DisasContext *s, int esz, int pg, int rm,
+--
+.25.1

-New patch
+[PULL 064/117] target/arm: Use TRANS_FEAT for do_clast_fp
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-62-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 11 ++---------
+file changed, 2 insertions(+), 9 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_clast_fp(DisasContext *s, arg_rpr_esz *a, bool before)
+     return true;
+ }
+-static bool trans_CLASTA_v(DisasContext *s, arg_rpr_esz *a)
+-{
+-    return do_clast_fp(s, a, false);
+-}
+-
+-static bool trans_CLASTB_v(DisasContext *s, arg_rpr_esz *a)
+-{
+-    return do_clast_fp(s, a, true);
+-}
++TRANS_FEAT(CLASTA_v, aa64_sve, do_clast_fp, a, false)
++TRANS_FEAT(CLASTB_v, aa64_sve, do_clast_fp, a, true)
+ /* Compute CLAST for a Xreg.  */
+ static bool do_clast_general(DisasContext *s, arg_rpr_esz *a, bool before)
+--
+.25.1

-New patch
+[PULL 065/117] target/arm: Use TRANS_FEAT for do_clast_general
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-63-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 11 ++---------
+file changed, 2 insertions(+), 9 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_clast_general(DisasContext *s, arg_rpr_esz *a, bool before)
+     return true;
+ }
+-static bool trans_CLASTA_r(DisasContext *s, arg_rpr_esz *a)
+-{
+-    return do_clast_general(s, a, false);
+-}
+-
+-static bool trans_CLASTB_r(DisasContext *s, arg_rpr_esz *a)
+-{
+-    return do_clast_general(s, a, true);
+-}
++TRANS_FEAT(CLASTA_r, aa64_sve, do_clast_general, a, false)
++TRANS_FEAT(CLASTB_r, aa64_sve, do_clast_general, a, true)
+ /* Compute LAST for a scalar.  */
+ static TCGv_i64 do_last_scalar(DisasContext *s, int esz,
+--
+.25.1

-New patch
+[PULL 066/117] target/arm: Use TRANS_FEAT for do_last_fp
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-64-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 11 ++---------
+file changed, 2 insertions(+), 9 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_last_fp(DisasContext *s, arg_rpr_esz *a, bool before)
+     return true;
+ }
+-static bool trans_LASTA_v(DisasContext *s, arg_rpr_esz *a)
+-{
+-    return do_last_fp(s, a, false);
+-}
+-
+-static bool trans_LASTB_v(DisasContext *s, arg_rpr_esz *a)
+-{
+-    return do_last_fp(s, a, true);
+-}
++TRANS_FEAT(LASTA_v, aa64_sve, do_last_fp, a, false)
++TRANS_FEAT(LASTB_v, aa64_sve, do_last_fp, a, true)
+ /* Compute LAST for a Xreg.  */
+ static bool do_last_general(DisasContext *s, arg_rpr_esz *a, bool before)
+--
+.25.1

-New patch
+[PULL 067/117] target/arm: Use TRANS_FEAT for do_last_general
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-65-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 11 ++---------
+file changed, 2 insertions(+), 9 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_last_general(DisasContext *s, arg_rpr_esz *a, bool before)
+     return true;
+ }
+-static bool trans_LASTA_r(DisasContext *s, arg_rpr_esz *a)
+-{
+-    return do_last_general(s, a, false);
+-}
+-
+-static bool trans_LASTB_r(DisasContext *s, arg_rpr_esz *a)
+-{
+-    return do_last_general(s, a, true);
+-}
++TRANS_FEAT(LASTA_r, aa64_sve, do_last_general, a, false)
++TRANS_FEAT(LASTB_r, aa64_sve, do_last_general, a, true)
+ static bool trans_CPY_m_r(DisasContext *s, arg_rpr_esz *a)
+ {
+--
+.25.1

-New patch
+[PULL 068/117] target/arm: Use TRANS_FEAT for SPLICE
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-66-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 17 ++++-------------
+file changed, 4 insertions(+), 13 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(REVH, aa64_sve, gen_gvec_ool_arg_zpz, revh_fns[a->esz], a, 0)
+ TRANS_FEAT(REVW, aa64_sve, gen_gvec_ool_arg_zpz,
+            a->esz == 3 ? gen_helper_sve_revw_d : NULL, a, 0)
+-static bool trans_SPLICE(DisasContext *s, arg_rprr_esz *a)
+-{
+-    return gen_gvec_ool_zzzp(s, gen_helper_sve_splice,
+-                             a->rd, a->rn, a->rm, a->pg, a->esz);
+-}
++TRANS_FEAT(SPLICE, aa64_sve, gen_gvec_ool_arg_zpzz,
++           gen_helper_sve_splice, a, a->esz)
+-static bool trans_SPLICE_sve2(DisasContext *s, arg_rpr_esz *a)
+-{
+-    if (!dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    return gen_gvec_ool_zzzp(s, gen_helper_sve_splice,
+-                             a->rd, a->rn, (a->rn + 1) % 32, a->pg, a->esz);
+-}
++TRANS_FEAT(SPLICE_sve2, aa64_sve2, gen_gvec_ool_zzzp, gen_helper_sve_splice,
++           a->rd, a->rn, (a->rn + 1) % 32, a->pg, a->esz)
+ /*
+  *** SVE Integer Compare - Vectors Group
+--
+.25.1

-New patch
+[PULL 069/117] target/arm: Use TRANS_FEAT for do_ppzz_flags
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-67-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 28 ++++++++++++----------------
+file changed, 12 insertions(+), 16 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_ppzz_flags(DisasContext *s, arg_rprr_esz *a,
+ }
+ #define DO_PPZZ(NAME, name) \
+-static bool trans_##NAME##_ppzz(DisasContext *s, arg_rprr_esz *a)         \
+-{                                                                         \
+-    static gen_helper_gvec_flags_4 * const fns[4] = {                     \
+-        gen_helper_sve_##name##_ppzz_b, gen_helper_sve_##name##_ppzz_h,   \
+-        gen_helper_sve_##name##_ppzz_s, gen_helper_sve_##name##_ppzz_d,   \
+-    };                                                                    \
+-    return do_ppzz_flags(s, a, fns[a->esz]);                              \
+-}
++    static gen_helper_gvec_flags_4 * const name##_ppzz_fns[4] = {       \
++        gen_helper_sve_##name##_ppzz_b, gen_helper_sve_##name##_ppzz_h, \
++        gen_helper_sve_##name##_ppzz_s, gen_helper_sve_##name##_ppzz_d, \
++    };                                                                  \
++    TRANS_FEAT(NAME##_ppzz, aa64_sve, do_ppzz_flags,                    \
++               a, name##_ppzz_fns[a->esz])
+ DO_PPZZ(CMPEQ, cmpeq)
+ DO_PPZZ(CMPNE, cmpne)
+@@ -XXX,XX +XXX,XX @@ DO_PPZZ(CMPHS, cmphs)
+ #undef DO_PPZZ
+ #define DO_PPZW(NAME, name) \
+-static bool trans_##NAME##_ppzw(DisasContext *s, arg_rprr_esz *a)         \
+-{                                                                         \
+-    static gen_helper_gvec_flags_4 * const fns[4] = {                     \
+-        gen_helper_sve_##name##_ppzw_b, gen_helper_sve_##name##_ppzw_h,   \
+-        gen_helper_sve_##name##_ppzw_s, NULL                              \
+-    };                                                                    \
+-    return do_ppzz_flags(s, a, fns[a->esz]);                              \
+-}
++    static gen_helper_gvec_flags_4 * const name##_ppzw_fns[4] = {       \
++        gen_helper_sve_##name##_ppzw_b, gen_helper_sve_##name##_ppzw_h, \
++        gen_helper_sve_##name##_ppzw_s, NULL                            \
++    };                                                                  \
++    TRANS_FEAT(NAME##_ppzw, aa64_sve, do_ppzz_flags,                    \
++               a, name##_ppzw_fns[a->esz])
+ DO_PPZW(CMPEQ, cmpeq)
+ DO_PPZW(CMPNE, cmpne)
+--
+.25.1

-New patch
+[PULL 070/117] target/arm: Use TRANS_FEAT for do_sve2_ppzz_flags
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-68-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 28 ++++++++--------------------
+file changed, 8 insertions(+), 20 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ DO_SVE2_ZZZ_NARROW(SUBHNT, subhnt)
+ DO_SVE2_ZZZ_NARROW(RSUBHNB, rsubhnb)
+ DO_SVE2_ZZZ_NARROW(RSUBHNT, rsubhnt)
+-static bool do_sve2_ppzz_flags(DisasContext *s, arg_rprr_esz *a,
+-                               gen_helper_gvec_flags_4 *fn)
+-{
+-    if (!dc_isar_feature(aa64_sve2, s)) {
+-        return false;
+-    }
+-    return do_ppzz_flags(s, a, fn);
+-}
++static gen_helper_gvec_flags_4 * const match_fns[4] = {
++    gen_helper_sve2_match_ppzz_b, gen_helper_sve2_match_ppzz_h, NULL, NULL
++};
++TRANS_FEAT(MATCH, aa64_sve2, do_ppzz_flags, a, match_fns[a->esz])
+-#define DO_SVE2_PPZZ_MATCH(NAME, name)                                      \
+-static bool trans_##NAME(DisasContext *s, arg_rprr_esz *a)                  \
+-{                                                                           \
+-    static gen_helper_gvec_flags_4 * const fns[4] = {                       \
+-        gen_helper_sve2_##name##_ppzz_b, gen_helper_sve2_##name##_ppzz_h,   \
+-        NULL,                            NULL                               \
+-    };                                                                      \
+-    return do_sve2_ppzz_flags(s, a, fns[a->esz]);                           \
+-}
+-
+-DO_SVE2_PPZZ_MATCH(MATCH, match)
+-DO_SVE2_PPZZ_MATCH(NMATCH, nmatch)
++static gen_helper_gvec_flags_4 * const nmatch_fns[4] = {
++    gen_helper_sve2_nmatch_ppzz_b, gen_helper_sve2_nmatch_ppzz_h, NULL, NULL
++};
++TRANS_FEAT(NMATCH, aa64_sve2, do_ppzz_flags, a, nmatch_fns[a->esz])
+ static gen_helper_gvec_4 * const histcnt_fns[4] = {
+     NULL, NULL, gen_helper_sve2_histcnt_s, gen_helper_sve2_histcnt_d
+--
+.25.1

-[Qemu-devel] [PULL 45/45] target/arm: Only flush tlb if ASID changes
+[PULL 071/117] target/arm: Use TRANS_FEAT for do_ppzi_flags
 From: Richard Henderson <richard.henderson@linaro.org>
-Since QEMU does not implement ASIDs, changes to the ASID must flush the
-tlb.  However, if the ASID does not change there is no reason to flush.
-In testing a boot of the Ubuntu installer to the first menu, this reduces
-the number of flushes by 30%, or nearly 600k instances.
-Reviewed-by: Aaron Lindsay <aaron@os.amperecomputing.com>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-69-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
-Message-id: 20181019015617.22583-3-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper.c | 8 +++-----
+ target/arm/translate-sve.c | 8 +++-----
 file changed, 3 insertions(+), 5 deletions(-)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/helper.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static void vmsa_tcr_el1_write(CPUARMState *env, const ARMCPRegInfo *ri,
+@@ -XXX,XX +XXX,XX @@ static bool do_ppzi_flags(DisasContext *s, arg_rpri_esz *a,
- static void vmsa_ttbr_write(CPUARMState *env, const ARMCPRegInfo *ri,
+ }
-                             uint64_t value)
- {
+ #define DO_PPZI(NAME, name) \
--    /* 64 bit accesses to the TTBRs can change the ASID and so we
+-static bool trans_##NAME##_ppzi(DisasContext *s, arg_rpri_esz *a)         \
--     * must flush the TLB.
+-{                                                                         \
--     */
+-    static gen_helper_gvec_flags_3 * const fns[4] = {                     \
--    if (cpreg_field_is_64bit(ri)) {
++    static gen_helper_gvec_flags_3 * const name##_ppzi_fns[4] = {         \
-+    /* If the ASID changes (with a 64-bit write), we must flush the TLB.  */
+         gen_helper_sve_##name##_ppzi_b, gen_helper_sve_##name##_ppzi_h,   \
-+    if (cpreg_field_is_64bit(ri) &&
+         gen_helper_sve_##name##_ppzi_s, gen_helper_sve_##name##_ppzi_d,   \
-+        extract64(raw_read(env, ri) ^ value, 48, 16) != 0) {
+     };                                                                    \
-         ARMCPU *cpu = arm_env_get_cpu(env);
+-    return do_ppzi_flags(s, a, fns[a->esz]);                              \
--
+-}
-         tlb_flush(CPU(cpu));
++    TRANS_FEAT(NAME##_ppzi, aa64_sve, do_ppzi_flags, a,                   \
-     }
++               name##_ppzi_fns[a->esz])
-     raw_write(env, ri, value);
  DO_PPZI(CMPEQ, cmpeq)
  DO_PPZI(CMPNE, cmpne)
 --
-.19.1
+.25.1

-New patch
+[PULL 072/117] target/arm: Use TRANS_FEAT for do_brk2, do_brk3
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-70-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 45 ++++++++++++--------------------------
+file changed, 14 insertions(+), 31 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool do_brk2(DisasContext *s, arg_rpr_s *a,
+     return true;
+ }
+-static bool trans_BRKPA(DisasContext *s, arg_rprr_s *a)
+-{
+-    return do_brk3(s, a, gen_helper_sve_brkpa, gen_helper_sve_brkpas);
+-}
++TRANS_FEAT(BRKPA, aa64_sve, do_brk3, a,
++           gen_helper_sve_brkpa, gen_helper_sve_brkpas)
++TRANS_FEAT(BRKPB, aa64_sve, do_brk3, a,
++           gen_helper_sve_brkpb, gen_helper_sve_brkpbs)
+-static bool trans_BRKPB(DisasContext *s, arg_rprr_s *a)
+-{
+-    return do_brk3(s, a, gen_helper_sve_brkpb, gen_helper_sve_brkpbs);
+-}
++TRANS_FEAT(BRKA_m, aa64_sve, do_brk2, a,
++           gen_helper_sve_brka_m, gen_helper_sve_brkas_m)
++TRANS_FEAT(BRKB_m, aa64_sve, do_brk2, a,
++           gen_helper_sve_brkb_m, gen_helper_sve_brkbs_m)
+-static bool trans_BRKA_m(DisasContext *s, arg_rpr_s *a)
+-{
+-    return do_brk2(s, a, gen_helper_sve_brka_m, gen_helper_sve_brkas_m);
+-}
++TRANS_FEAT(BRKA_z, aa64_sve, do_brk2, a,
++           gen_helper_sve_brka_z, gen_helper_sve_brkas_z)
++TRANS_FEAT(BRKB_z, aa64_sve, do_brk2, a,
++           gen_helper_sve_brkb_z, gen_helper_sve_brkbs_z)
+-static bool trans_BRKB_m(DisasContext *s, arg_rpr_s *a)
+-{
+-    return do_brk2(s, a, gen_helper_sve_brkb_m, gen_helper_sve_brkbs_m);
+-}
+-
+-static bool trans_BRKA_z(DisasContext *s, arg_rpr_s *a)
+-{
+-    return do_brk2(s, a, gen_helper_sve_brka_z, gen_helper_sve_brkas_z);
+-}
+-
+-static bool trans_BRKB_z(DisasContext *s, arg_rpr_s *a)
+-{
+-    return do_brk2(s, a, gen_helper_sve_brkb_z, gen_helper_sve_brkbs_z);
+-}
+-
+-static bool trans_BRKN(DisasContext *s, arg_rpr_s *a)
+-{
+-    return do_brk2(s, a, gen_helper_sve_brkn, gen_helper_sve_brkns);
+-}
++TRANS_FEAT(BRKN, aa64_sve, do_brk2, a,
++           gen_helper_sve_brkn, gen_helper_sve_brkns)
+ /*
+  *** SVE Predicate Count Group
+--
+.25.1

-New patch
+[PULL 073/117] target/arm: Use TRANS_FEAT for MUL_zzi
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-71-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 10 +---------
+file changed, 1 insertion(+), 9 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool trans_SUBR_zzi(DisasContext *s, arg_rri_esz *a)
+     return true;
+ }
+-static bool trans_MUL_zzi(DisasContext *s, arg_rri_esz *a)
+-{
+-    if (sve_access_check(s)) {
+-        unsigned vsz = vec_full_reg_size(s);
+-        tcg_gen_gvec_muli(a->esz, vec_full_reg_offset(s, a->rd),
+-                          vec_full_reg_offset(s, a->rn), a->imm, vsz, vsz);
+-    }
+-    return true;
+-}
++TRANS_FEAT(MUL_zzi, aa64_sve, gen_gvec_fn_arg_zzi, tcg_gen_gvec_muli, a)
+ static bool do_zzi_sat(DisasContext *s, arg_rri_esz *a, bool u, bool d)
+ {
+--
+.25.1

-[Qemu-devel] [PULL 18/45] target/arm: New utility function to extract EC from syndrome
+[PULL 074/117] target/arm: Reject dup_i w/ shifted byte early
-Create and use a utility function to extract the EC field
+From: Richard Henderson <richard.henderson@linaro.org>
 from a syndrome, rather than open-coding the shift.
+Remove the unparsed extraction in trans_DUP_i,
+which is intended to reject an 8-bit shift of
+an 8-bit constant for 8-bit element.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-72-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181012144235.19646-9-peter.maydell@linaro.org
 ---
- target/arm/internals.h | 5 +++++
+ target/arm/sve.decode      |  5 ++++-
- target/arm/helper.c    | 4 ++--
+ target/arm/translate-sve.c | 10 ++++++----
- target/arm/kvm64.c     | 2 +-
+files changed, 10 insertions(+), 5 deletions(-)
  target/arm/op_helper.c | 2 +-
 files changed, 9 insertions(+), 4 deletions(-)
-diff --git a/target/arm/internals.h b/target/arm/internals.h
+diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/internals.h
+--- a/target/arm/sve.decode
-+++ b/target/arm/internals.h
++++ b/target/arm/sve.decode
-@@ -XXX,XX +XXX,XX @@ enum arm_exception_class {
+@@ -XXX,XX +XXX,XX @@ WHILE_ptr       00100101 esz:2 1 rm:5 001 100 rn:5 rw:1 rd:4
- #define ARM_EL_IL (1 << ARM_EL_IL_SHIFT)
+ FDUP            00100101 esz:2 111 00 1110 imm:8 rd:5
- #define ARM_EL_ISV (1 << ARM_EL_ISV_SHIFT)
+ # SVE broadcast integer immediate (unpredicated)
-+static inline uint32_t syn_get_ec(uint32_t syn)
+-DUP_i           00100101 esz:2 111 00 011 . ........ rd:5       imm=%sh8_i8s
 +{
-+    return syn >> ARM_EL_EC_SHIFT;
++  INVALID       00100101 00    111 00 011 1 -------- -----
 +  DUP_i         00100101 esz:2 111 00 011 . ........ rd:5       imm=%sh8_i8s
 +}
  # SVE integer add/subtract immediate (unpredicated)
  ADD_zzi         00100101 .. 100 000 11 . ........ .....         @rdn_sh_i8u
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-sve.c
 +++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ const uint64_t pred_esz_masks[4] = {
 x1111111111111111ull, 0x0101010101010101ull
  };
 +static bool trans_INVALID(DisasContext *s, arg_INVALID *a)
 +{
 +    unallocated_encoding(s);
 +    return true;
 +}
 +
- /* Utility functions for constructing various kinds of syndrome value.
+ /*
-  * Note that in general we follow the AArch64 syndrome values; in a
+  *** SVE Logical - Unpredicated Group
-  * few cases the value in HSR for exceptions taken to AArch32 Hyp
+  */
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+@@ -XXX,XX +XXX,XX @@ static bool trans_FDUP(DisasContext *s, arg_FDUP *a)
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+ static bool trans_DUP_i(DisasContext *s, arg_DUP_i *a)
-+++ b/target/arm/helper.c
+ {
-@@ -XXX,XX +XXX,XX @@ static void arm_cpu_do_interrupt_aarch32(CPUState *cs)
+-    if (a->esz == 0 && extract32(s->insn, 13, 1)) {
-     uint32_t moe;
+-        return false;
+-    }
-     /* If this is a debug exception we must update the DBGDSCR.MOE bits */
+     if (sve_access_check(s)) {
--    switch (env->exception.syndrome >> ARM_EL_EC_SHIFT) {
+         unsigned vsz = vec_full_reg_size(s);
-+    switch (syn_get_ec(env->exception.syndrome)) {
+         int dofs = vec_full_reg_offset(s, a->rd);
-     case EC_BREAKPOINT:
+-
-     case EC_BREAKPOINT_SAME_EL:
+         tcg_gen_gvec_dup_imm(a->esz, dofs, vsz, vsz, a->imm);
          moe = 1;
@@ -XXX,XX +XXX,XX @@ void arm_cpu_do_interrupt(CPUState *cs)
      if (qemu_loglevel_mask(CPU_LOG_INT)
          && !excp_is_internal(cs->exception_index)) {
          qemu_log_mask(CPU_LOG_INT, "...with ESR 0x%x/0x%" PRIx32 "\n",
 -                      env->exception.syndrome >> ARM_EL_EC_SHIFT,
 +                      syn_get_ec(env->exception.syndrome),
                        env->exception.syndrome);
      }
+     return true;
 diff --git a/target/arm/kvm64.c b/target/arm/kvm64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/kvm64.c
 +++ b/target/arm/kvm64.c
@@ -XXX,XX +XXX,XX @@ int kvm_arch_remove_sw_breakpoint(CPUState *cs, struct kvm_sw_breakpoint *bp)
  bool kvm_arm_handle_debug(CPUState *cs, struct kvm_debug_exit_arch *debug_exit)
  {
 -    int hsr_ec = debug_exit->hsr >> ARM_EL_EC_SHIFT;
 +    int hsr_ec = syn_get_ec(debug_exit->hsr);
      ARMCPU *cpu = ARM_CPU(cs);
      CPUClass *cc = CPU_GET_CLASS(cs);
      CPUARMState *env = &cpu->env;
 diff --git a/target/arm/op_helper.c b/target/arm/op_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/op_helper.c
 +++ b/target/arm/op_helper.c
@@ -XXX,XX +XXX,XX @@ void raise_exception(CPUARMState *env, uint32_t excp,
           * (see DDI0478C.a D1.10.4)
           */
          target_el = 2;
 -        if (syndrome >> ARM_EL_EC_SHIFT == EC_ADVSIMDFPACCESSTRAP) {
 +        if (syn_get_ec(syndrome) == EC_ADVSIMDFPACCESSTRAP) {
              syndrome = syn_uncategorized();
          }
      }
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 12/45] target/arm: Make switch_mode() file-local
+[PULL 075/117] target/arm: Reject add/sub w/ shifted byte early
-The switch_mode() function is defined in target/arm/helper.c and used
+From: Richard Henderson <richard.henderson@linaro.org>
 only in that file and nowhere else, so we can make it file-local
 rather than global.
+Remove the unparsed extractions in trans_ADD_zzi, trans_SUBR_zzi,
+and do_zzi_sat which are intended to reject an 8-bit shift of an
+-bit constant for 8-bit element.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-73-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181012144235.19646-3-peter.maydell@linaro.org
 ---
- target/arm/internals.h | 1 -
+ target/arm/sve.decode      | 35 ++++++++++++++++++++++++++++-------
- target/arm/helper.c    | 6 ++++--
+ target/arm/translate-sve.c |  9 ---------
-files changed, 4 insertions(+), 3 deletions(-)
+files changed, 28 insertions(+), 16 deletions(-)
-diff --git a/target/arm/internals.h b/target/arm/internals.h
+diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/internals.h
+--- a/target/arm/sve.decode
-+++ b/target/arm/internals.h
++++ b/target/arm/sve.decode
-@@ -XXX,XX +XXX,XX @@ static inline int bank_number(int mode)
+@@ -XXX,XX +XXX,XX @@ FDUP            00100101 esz:2 111 00 1110 imm:8 rd:5
      g_assert_not_reached();
  }
--void switch_mode(CPUARMState *, int);
+ # SVE integer add/subtract immediate (unpredicated)
- void arm_cpu_register_gdb_regs_for_features(ARMCPU *cpu);
+-ADD_zzi         00100101 .. 100 000 11 . ........ .....         @rdn_sh_i8u
- void arm_translate_init(void);
+-SUB_zzi         00100101 .. 100 001 11 . ........ .....         @rdn_sh_i8u
+-SUBR_zzi        00100101 .. 100 011 11 . ........ .....         @rdn_sh_i8u
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+-SQADD_zzi       00100101 .. 100 100 11 . ........ .....         @rdn_sh_i8u
 -UQADD_zzi       00100101 .. 100 101 11 . ........ .....         @rdn_sh_i8u
 -SQSUB_zzi       00100101 .. 100 110 11 . ........ .....         @rdn_sh_i8u
 -UQSUB_zzi       00100101 .. 100 111 11 . ........ .....         @rdn_sh_i8u
 +{
 +  INVALID       00100101 00 100 000 11 1 -------- -----
 +  ADD_zzi       00100101 .. 100 000 11 . ........ .....         @rdn_sh_i8u
 +}
 +{
 +  INVALID       00100101 00 100 001 11 1 -------- -----
 +  SUB_zzi       00100101 .. 100 001 11 . ........ .....         @rdn_sh_i8u
 +}
 +{
 +  INVALID       00100101 00 100 011 11 1 -------- -----
 +  SUBR_zzi      00100101 .. 100 011 11 . ........ .....         @rdn_sh_i8u
 +}
 +{
 +  INVALID       00100101 00 100 100 11 1 -------- -----
 +  SQADD_zzi     00100101 .. 100 100 11 . ........ .....         @rdn_sh_i8u
 +}
 +{
 +  INVALID       00100101 00 100 101 11 1 -------- -----
 +  UQADD_zzi     00100101 .. 100 101 11 . ........ .....         @rdn_sh_i8u
 +}
 +{
 +  INVALID       00100101 00 100 110 11 1 -------- -----
 +  SQSUB_zzi     00100101 .. 100 110 11 . ........ .....         @rdn_sh_i8u
 +}
 +{
 +  INVALID       00100101 00 100 111 11 1 -------- -----
 +  UQSUB_zzi     00100101 .. 100 111 11 . ........ .....         @rdn_sh_i8u
 +}
  # SVE integer min/max immediate (unpredicated)
  SMAX_zzi        00100101 .. 101 000 110 ........ .....          @rdn_i8s
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/helper.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static void v8m_security_lookup(CPUARMState *env, uint32_t address,
+@@ -XXX,XX +XXX,XX @@ static bool trans_DUP_i(DisasContext *s, arg_DUP_i *a)
-                                 V8M_SAttributes *sattrs);
- #endif
+ static bool trans_ADD_zzi(DisasContext *s, arg_rri_esz *a)
 +static void switch_mode(CPUARMState *env, int mode);
 +
  static int vfp_gdb_get_reg(CPUARMState *env, uint8_t *buf, int reg)
  {
-     int nregs;
+-    if (a->esz == 0 && extract32(s->insn, 13, 1)) {
-@@ -XXX,XX +XXX,XX @@ uint32_t HELPER(v7m_tt)(CPUARMState *env, uint32_t addr, uint32_t op)
+-        return false;
-     return 0;
+-    }
      return gen_gvec_fn_arg_zzi(s, tcg_gen_gvec_addi, a);
  }
--void switch_mode(CPUARMState *env, int mode)
+@@ -XXX,XX +XXX,XX @@ static bool trans_SUBR_zzi(DisasContext *s, arg_rri_esz *a)
-+static void switch_mode(CPUARMState *env, int mode)
+           .scalar_first = true }
      };
 -    if (a->esz == 0 && extract32(s->insn, 13, 1)) {
 -        return false;
 -    }
      if (sve_access_check(s)) {
          unsigned vsz = vec_full_reg_size(s);
          tcg_gen_gvec_2s(vec_full_reg_offset(s, a->rd),
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(MUL_zzi, aa64_sve, gen_gvec_fn_arg_zzi, tcg_gen_gvec_muli, a)
  static bool do_zzi_sat(DisasContext *s, arg_rri_esz *a, bool u, bool d)
  {
-     ARMCPU *cpu = arm_env_get_cpu(env);
+-    if (a->esz == 0 && extract32(s->insn, 13, 1)) {
+-        return false;
-@@ -XXX,XX +XXX,XX @@ void aarch64_sync_64_to_32(CPUARMState *env)
+-    }
+     if (sve_access_check(s)) {
- #else
+         do_sat_addsub_vec(s, a->esz, a->rd, a->rn,
+                           tcg_constant_i64(a->imm), u, d);
 -void switch_mode(CPUARMState *env, int mode)
 +static void switch_mode(CPUARMState *env, int mode)
  {
      int old_mode;
      int i;
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 40/45] target/arm: Promote consecutive memory ops for aa32
+[PULL 076/117] target/arm: Reject copy w/ shifted byte early
 From: Richard Henderson <richard.henderson@linaro.org>
-For a sequence of loads or stores from a single register,
+Remove the unparsed extractions in trans_CPY_{m,z}_i which are intended
-little-endian operations can be promoted to an 8-byte op.
+to reject an 8-bit shift of an 8-bit constant for 8-bit element.
 This can reduce the number of operations by a factor of 8.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-20-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-74-richard.henderson@linaro.org
 Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 10 ++++++++++
+ target/arm/sve.decode      | 10 ++++++++--
-file changed, 10 insertions(+)
+ target/arm/translate-sve.c |  6 ------
 files changed, 8 insertions(+), 8 deletions(-)
-diff --git a/target/arm/translate.c b/target/arm/translate.c
+diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
+--- a/target/arm/sve.decode
-+++ b/target/arm/translate.c
++++ b/target/arm/sve.decode
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ DUPM            00000101 11 0000 dbm:13 rd:5
-         if (size == 3 && (interleave | spacing) != 1) {
+ FCPY            00000101 .. 01 .... 110 imm:8 .....             @rdn_pg4
-             return 1;
-         }
+ # SVE copy integer immediate (predicated)
-+        /* For our purposes, bytes are always little-endian.  */
+-CPY_m_i         00000101 .. 01 .... 01 . ........ .....   @rdn_pg4 imm=%sh8_i8s
-+        if (size == 0) {
+-CPY_z_i         00000101 .. 01 .... 00 . ........ .....   @rdn_pg4 imm=%sh8_i8s
-+            endian = MO_LE;
++{
-+        }
++  INVALID       00000101 00 01 ---- 01 1 -------- -----
-+        /* Consecutive little-endian elements from a single register
++  CPY_m_i       00000101 .. 01 .... 01 . ........ .....   @rdn_pg4 imm=%sh8_i8s
-+         * can be promoted to a larger little-endian operation.
++}
-+         */
++{
-+        if (interleave == 1 && endian == MO_LE) {
++  INVALID       00000101 00 01 ---- 00 1 -------- -----
-+            size = 3;
++  CPY_z_i       00000101 .. 01 .... 00 . ........ .....   @rdn_pg4 imm=%sh8_i8s
-+        }
++}
-         tmp64 = tcg_temp_new_i64();
-         addr = tcg_temp_new_i32();
+ ### SVE Permute - Extract Group
-         tmp2 = tcg_const_i32(1 << size);
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-sve.c
 +++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_FCPY(DisasContext *s, arg_FCPY *a)
  static bool trans_CPY_m_i(DisasContext *s, arg_rpri_esz *a)
  {
 -    if (a->esz == 0 && extract32(s->insn, 13, 1)) {
 -        return false;
 -    }
      if (sve_access_check(s)) {
          do_cpy_m(s, a->esz, a->rd, a->rn, a->pg, tcg_constant_i64(a->imm));
      }
@@ -XXX,XX +XXX,XX @@ static bool trans_CPY_z_i(DisasContext *s, arg_CPY_z_i *a)
          gen_helper_sve_cpy_z_s, gen_helper_sve_cpy_z_d,
      };
 -    if (a->esz == 0 && extract32(s->insn, 13, 1)) {
 -        return false;
 -    }
      if (sve_access_check(s)) {
          unsigned vsz = vec_full_reg_size(s);
          tcg_gen_gvec_2i_ool(vec_full_reg_offset(s, a->rd),
 --
-.19.1
+.25.1

-New patch
+[PULL 077/117] target/arm: Use TRANS_FEAT for ADD_zzi
+From: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-75-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+---
+ target/arm/translate-sve.c | 5 +----
+file changed, 1 insertion(+), 4 deletions(-)
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/arm/translate-sve.c
++++ b/target/arm/translate-sve.c
+@@ -XXX,XX +XXX,XX @@ static bool trans_DUP_i(DisasContext *s, arg_DUP_i *a)
+     return true;
+ }
+-static bool trans_ADD_zzi(DisasContext *s, arg_rri_esz *a)
+-{
+-    return gen_gvec_fn_arg_zzi(s, tcg_gen_gvec_addi, a);
+-}
++TRANS_FEAT(ADD_zzi, aa64_sve, gen_gvec_fn_arg_zzi, tcg_gen_gvec_addi, a)
+ static bool trans_SUB_zzi(DisasContext *s, arg_rri_esz *a)
+ {
+--
+.25.1

-[Qemu-devel] [PULL 44/45] target/arm: Remove writefn from TTBR0_EL3
+[PULL 078/117] target/arm: Use TRANS_FEAT for do_zzi_sat
 From: Richard Henderson <richard.henderson@linaro.org>
-The EL3 version of this register does not include an ASID,
-and so the tlb_flush performed by vmsa_ttbr_write is not needed.
-Reviewed-by: Aaron Lindsay <aaron@os.amperecomputing.com>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-76-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Message-id: 20181019015617.22583-2-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper.c | 2 +-
+ target/arm/translate-sve.c | 23 ++++-------------------
-file changed, 1 insertion(+), 1 deletion(-)
+file changed, 4 insertions(+), 19 deletions(-)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/helper.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo el3_cp_reginfo[] = {
+@@ -XXX,XX +XXX,XX @@ static bool do_zzi_sat(DisasContext *s, arg_rri_esz *a, bool u, bool d)
-       .fieldoffset = offsetof(CPUARMState, cp15.mvbar) },
+     return true;
-     { .name = "TTBR0_EL3", .state = ARM_CP_STATE_AA64,
+ }
-       .opc0 = 3, .opc1 = 6, .crn = 2, .crm = 0, .opc2 = 0,
--      .access = PL3_RW, .writefn = vmsa_ttbr_write, .resetvalue = 0,
+-static bool trans_SQADD_zzi(DisasContext *s, arg_rri_esz *a)
-+      .access = PL3_RW, .resetvalue = 0,
+-{
-       .fieldoffset = offsetof(CPUARMState, cp15.ttbr0_el[3]) },
+-    return do_zzi_sat(s, a, false, false);
-     { .name = "TCR_EL3", .state = ARM_CP_STATE_AA64,
+-}
-       .opc0 = 3, .opc1 = 6, .crn = 2, .crm = 0, .opc2 = 2,
+-
 -static bool trans_UQADD_zzi(DisasContext *s, arg_rri_esz *a)
 -{
 -    return do_zzi_sat(s, a, true, false);
 -}
 -
 -static bool trans_SQSUB_zzi(DisasContext *s, arg_rri_esz *a)
 -{
 -    return do_zzi_sat(s, a, false, true);
 -}
 -
 -static bool trans_UQSUB_zzi(DisasContext *s, arg_rri_esz *a)
 -{
 -    return do_zzi_sat(s, a, true, true);
 -}
 +TRANS_FEAT(SQADD_zzi, aa64_sve, do_zzi_sat, a, false, false)
 +TRANS_FEAT(UQADD_zzi, aa64_sve, do_zzi_sat, a, true, false)
 +TRANS_FEAT(SQSUB_zzi, aa64_sve, do_zzi_sat, a, false, true)
 +TRANS_FEAT(UQSUB_zzi, aa64_sve, do_zzi_sat, a, true, true)
  static bool do_zzi_ool(DisasContext *s, arg_rri_esz *a, gen_helper_gvec_2i *fn)
  {
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 43/45] net: cadence_gem: Announce 64bit addressing support
+[PULL 079/117] target/arm: Use TRANS_FEAT for do_zzi_ool
-From: "Edgar E. Iglesias" <edgar.iglesias@xilinx.com>
+From: Richard Henderson <richard.henderson@linaro.org>
-Announce 64bit addressing support.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-77-richard.henderson@linaro.org
 Reviewed-by: Alistair Francis <alistair.francis@wdc.com>
 Signed-off-by: Edgar E. Iglesias <edgar.iglesias@xilinx.com>
 Message-id: 20181017213932.19973-3-edgar.iglesias@gmail.com
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- hw/net/cadence_gem.c | 3 ++-
+ target/arm/translate-sve.c | 7 ++-----
-file changed, 2 insertions(+), 1 deletion(-)
+file changed, 2 insertions(+), 5 deletions(-)
-diff --git a/hw/net/cadence_gem.c b/hw/net/cadence_gem.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/hw/net/cadence_gem.c
+--- a/target/arm/translate-sve.c
-+++ b/hw/net/cadence_gem.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@
+@@ -XXX,XX +XXX,XX @@ static bool do_zzi_ool(DisasContext *s, arg_rri_esz *a, gen_helper_gvec_2i *fn)
- #define GEM_DESCONF4      (0x0000028C/4)
+ }
- #define GEM_DESCONF5      (0x00000290/4)
- #define GEM_DESCONF6      (0x00000294/4)
+ #define DO_ZZI(NAME, name) \
-+#define GEM_DESCONF6_64B_MASK (1U << 23)
+-static bool trans_##NAME##_zzi(DisasContext *s, arg_rri_esz *a)         \
- #define GEM_DESCONF7      (0x00000298/4)
+-{                                                                       \
+-    static gen_helper_gvec_2i * const fns[4] = {                        \
- #define GEM_INT_Q1_STATUS               (0x00000400 / 4)
++    static gen_helper_gvec_2i * const name##i_fns[4] = {                \
-@@ -XXX,XX +XXX,XX @@ static void gem_reset(DeviceState *d)
+         gen_helper_sve_##name##i_b, gen_helper_sve_##name##i_h,         \
-     s->regs[GEM_DESCONF] = 0x02500111;
+         gen_helper_sve_##name##i_s, gen_helper_sve_##name##i_d,         \
-     s->regs[GEM_DESCONF2] = 0x2ab13fff;
+     };                                                                  \
-     s->regs[GEM_DESCONF5] = 0x002f2045;
+-    return do_zzi_ool(s, a, fns[a->esz]);                               \
--    s->regs[GEM_DESCONF6] = 0x0;
+-}
-+    s->regs[GEM_DESCONF6] = GEM_DESCONF6_64B_MASK;
++    TRANS_FEAT(NAME##_zzi, aa64_sve, do_zzi_ool, a, name##i_fns[a->esz])
-     if (s->num_priority_queues > 1) {
+ DO_ZZI(SMAX, smax)
-         queues_mask = MAKE_64BIT_MASK(1, s->num_priority_queues - 1);
+ DO_ZZI(UMAX, umax)
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 16/45] target/arm: Implement HCR.VI and VF
+[PULL 080/117] target/arm: Introduce gen_gvec_{ptr,fpst}_zzzz
-The HCR_EL2 VI and VF bits are supposed to track whether there is
+From: Richard Henderson <richard.henderson@linaro.org>
 a pending virtual IRQ or virtual FIQ. For QEMU we store the
 pending VIRQ/VFIQ status in cs->interrupt_request, so this means:
  * if the register is read we must get these bit values from
    cs->interrupt_request
  * if the register is written then we must write the bit
    values back into cs->interrupt_request
+Use these for the several varieties of floating-point
+multiply-add instructions.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-78-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181012144235.19646-7-peter.maydell@linaro.org
 ---
- target/arm/helper.c | 47 +++++++++++++++++++++++++++++++++++++++++----
+ target/arm/translate-sve.c | 140 ++++++++++++++-----------------------
-file changed, 43 insertions(+), 4 deletions(-)
+file changed, 53 insertions(+), 87 deletions(-)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/helper.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo el3_no_el2_v8_cp_reginfo[] = {
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_arg_zzxz(DisasContext *s, gen_helper_gvec_4 *fn,
- static void hcr_write(CPUARMState *env, const ARMCPRegInfo *ri, uint64_t value)
+     return gen_gvec_ool_zzzz(s, fn, a->rd, a->rn, a->rm, a->ra, a->index);
- {
+ }
-     ARMCPU *cpu = arm_env_get_cpu(env);
-+    CPUState *cs = ENV_GET_CPU(env);
++/* Invoke an out-of-line helper on 4 Zregs, plus a pointer. */
-     uint64_t valid_mask = HCR_MASK;
++static bool gen_gvec_ptr_zzzz(DisasContext *s, gen_helper_gvec_4_ptr *fn,
++                              int rd, int rn, int rm, int ra,
-     if (arm_feature(env, ARM_FEATURE_EL3)) {
++                              int data, TCGv_ptr ptr)
-@@ -XXX,XX +XXX,XX @@ static void hcr_write(CPUARMState *env, const ARMCPRegInfo *ri, uint64_t value)
++{
-     /* Clear RES0 bits.  */
++    if (fn == NULL) {
-     value &= valid_mask;
++        return false;
 +    /*
 +     * VI and VF are kept in cs->interrupt_request. Modifying that
 +     * requires that we have the iothread lock, which is done by
 +     * marking the reginfo structs as ARM_CP_IO.
 +     * Note that if a write to HCR pends a VIRQ or VFIQ it is never
 +     * possible for it to be taken immediately, because VIRQ and
 +     * VFIQ are masked unless running at EL0 or EL1, and HCR
 +     * can only be written at EL2.
 +     */
 +    g_assert(qemu_mutex_iothread_locked());
 +    if (value & HCR_VI) {
 +        cs->interrupt_request |= CPU_INTERRUPT_VIRQ;
 +    } else {
 +        cs->interrupt_request &= ~CPU_INTERRUPT_VIRQ;
 +    }
-+    if (value & HCR_VF) {
++    if (sve_access_check(s)) {
-+        cs->interrupt_request |= CPU_INTERRUPT_VFIQ;
++        unsigned vsz = vec_full_reg_size(s);
-+    } else {
++        tcg_gen_gvec_4_ptr(vec_full_reg_offset(s, rd),
-+        cs->interrupt_request &= ~CPU_INTERRUPT_VFIQ;
++                           vec_full_reg_offset(s, rn),
 +                           vec_full_reg_offset(s, rm),
 +                           vec_full_reg_offset(s, ra),
 +                           ptr, vsz, vsz, data, fn);
 +    }
-+    value &= ~(HCR_VI | HCR_VF);
++    return true;
 +}
 +
-     /* These bits change the MMU setup:
++static bool gen_gvec_fpst_zzzz(DisasContext *s, gen_helper_gvec_4_ptr *fn,
-      * HCR_VM enables stage 2 translation
++                               int rd, int rn, int rm, int ra,
-      * HCR_PTW forbids certain page-table setups
++                               int data, ARMFPStatusFlavour flavour)
@@ -XXX,XX +XXX,XX @@ static void hcr_writelow(CPUARMState *env, const ARMCPRegInfo *ri,
      hcr_write(env, NULL, value);
  }
 +static uint64_t hcr_read(CPUARMState *env, const ARMCPRegInfo *ri)
 +{
-+    /* The VI and VF bits live in cs->interrupt_request */
++    TCGv_ptr status = fpstatus_ptr(flavour);
-+    uint64_t ret = env->cp15.hcr_el2 & ~(HCR_VI | HCR_VF);
++    bool ret = gen_gvec_ptr_zzzz(s, fn, rd, rn, rm, ra, data, status);
-+    CPUState *cs = ENV_GET_CPU(env);
++    tcg_temp_free_ptr(status);
 +
 +    if (cs->interrupt_request & CPU_INTERRUPT_VIRQ) {
 +        ret |= HCR_VI;
 +    }
 +    if (cs->interrupt_request & CPU_INTERRUPT_VFIQ) {
 +        ret |= HCR_VF;
 +    }
 +    return ret;
 +}
 +
- static const ARMCPRegInfo el2_cp_reginfo[] = {
+ /* Invoke an out-of-line helper on 2 Zregs and a predicate. */
-     { .name = "HCR_EL2", .state = ARM_CP_STATE_AA64,
+ static bool gen_gvec_ool_zzp(DisasContext *s, gen_helper_gvec_3 *fn,
-+      .type = ARM_CP_IO,
+                              int rd, int rn, int pg, int data)
-       .opc0 = 3, .opc1 = 4, .crn = 1, .crm = 1, .opc2 = 0,
+@@ -XXX,XX +XXX,XX @@ DO_SVE2_RRXR_ROT(CDOT_zzxw_d, gen_helper_sve2_cdot_idx_d)
-       .access = PL2_RW, .fieldoffset = offsetof(CPUARMState, cp15.hcr_el2),
--      .writefn = hcr_write },
+ static bool do_FMLA_zzxz(DisasContext *s, arg_rrxr_esz *a, bool sub)
-+      .writefn = hcr_write, .readfn = hcr_read },
+ {
-     { .name = "HCR", .state = ARM_CP_STATE_AA32,
+-    static gen_helper_gvec_4_ptr * const fns[3] = {
--      .type = ARM_CP_ALIAS,
++    static gen_helper_gvec_4_ptr * const fns[4] = {
-+      .type = ARM_CP_ALIAS | ARM_CP_IO,
++        NULL,
-       .cp = 15, .opc1 = 4, .crn = 1, .crm = 1, .opc2 = 0,
+         gen_helper_gvec_fmla_idx_h,
-       .access = PL2_RW, .fieldoffset = offsetof(CPUARMState, cp15.hcr_el2),
+         gen_helper_gvec_fmla_idx_s,
--      .writefn = hcr_writelow },
+         gen_helper_gvec_fmla_idx_d,
-+      .writefn = hcr_writelow, .readfn = hcr_read },
+     };
-     { .name = "ELR_EL2", .state = ARM_CP_STATE_AA64,
+-
-       .type = ARM_CP_ALIAS,
+-    if (sve_access_check(s)) {
-       .opc0 = 3, .opc1 = 4, .crn = 4, .crm = 0, .opc2 = 1,
+-        unsigned vsz = vec_full_reg_size(s);
-@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo el2_cp_reginfo[] = {
+-        TCGv_ptr status = fpstatus_ptr(a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
+-        tcg_gen_gvec_4_ptr(vec_full_reg_offset(s, a->rd),
- static const ARMCPRegInfo el2_v8_cp_reginfo[] = {
+-                           vec_full_reg_offset(s, a->rn),
-     { .name = "HCR2", .state = ARM_CP_STATE_AA32,
+-                           vec_full_reg_offset(s, a->rm),
--      .type = ARM_CP_ALIAS,
+-                           vec_full_reg_offset(s, a->ra),
-+      .type = ARM_CP_ALIAS | ARM_CP_IO,
+-                           status, vsz, vsz, (a->index << 1) | sub,
-       .cp = 15, .opc1 = 4, .crn = 1, .crm = 1, .opc2 = 4,
+-                           fns[a->esz - 1]);
-       .access = PL2_RW,
+-        tcg_temp_free_ptr(status);
-       .fieldoffset = offsetofhigh32(CPUARMState, cp15.hcr_el2),
+-    }
 -    return true;
 +    return gen_gvec_fpst_zzzz(s, fns[a->esz], a->rd, a->rn, a->rm, a->ra,
 +                              (a->index << 1) | sub,
 +                              a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
  }
  static bool trans_FMLA_zzxz(DisasContext *s, arg_FMLA_zzxz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_FCMLA_zpzzz(DisasContext *s, arg_FCMLA_zpzzz *a)
  static bool trans_FCMLA_zzxz(DisasContext *s, arg_FCMLA_zzxz *a)
  {
 -    static gen_helper_gvec_4_ptr * const fns[2] = {
 +    static gen_helper_gvec_4_ptr * const fns[4] = {
 +        NULL,
          gen_helper_gvec_fcmlah_idx,
          gen_helper_gvec_fcmlas_idx,
 +        NULL,
      };
 -    tcg_debug_assert(a->esz == 1 || a->esz == 2);
      tcg_debug_assert(a->rd == a->ra);
 -    if (sve_access_check(s)) {
 -        unsigned vsz = vec_full_reg_size(s);
 -        TCGv_ptr status = fpstatus_ptr(a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
 -        tcg_gen_gvec_4_ptr(vec_full_reg_offset(s, a->rd),
 -                           vec_full_reg_offset(s, a->rn),
 -                           vec_full_reg_offset(s, a->rm),
 -                           vec_full_reg_offset(s, a->ra),
 -                           status, vsz, vsz,
 -                           a->index * 4 + a->rot,
 -                           fns[a->esz - 1]);
 -        tcg_temp_free_ptr(status);
 -    }
 -    return true;
 +
 +    return gen_gvec_fpst_zzzz(s, fns[a->esz], a->rd, a->rn, a->rm, a->ra,
 +                              a->index * 4 + a->rot,
 +                              a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
  }
  /*
@@ -XXX,XX +XXX,XX @@ static bool trans_FMMLA(DisasContext *s, arg_rrrr_esz *a)
          return false;
      }
 -    if (sve_access_check(s)) {
 -        unsigned vsz = vec_full_reg_size(s);
 -        TCGv_ptr status = fpstatus_ptr(FPST_FPCR);
 -        tcg_gen_gvec_4_ptr(vec_full_reg_offset(s, a->rd),
 -                           vec_full_reg_offset(s, a->rn),
 -                           vec_full_reg_offset(s, a->rm),
 -                           vec_full_reg_offset(s, a->ra),
 -                           status, vsz, vsz, 0, fn);
 -        tcg_temp_free_ptr(status);
 -    }
 -    return true;
 +    return gen_gvec_fpst_zzzz(s, fn, a->rd, a->rn, a->rm, a->ra, 0, FPST_FPCR);
  }
  static gen_helper_gvec_4 * const sqdmlal_zzzw_fns[] = {
@@ -XXX,XX +XXX,XX @@ static bool do_FMLAL_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sub, bool sel)
      if (!dc_isar_feature(aa64_sve2, s)) {
          return false;
      }
 -    if (sve_access_check(s)) {
 -        unsigned vsz = vec_full_reg_size(s);
 -        tcg_gen_gvec_4_ptr(vec_full_reg_offset(s, a->rd),
 -                           vec_full_reg_offset(s, a->rn),
 -                           vec_full_reg_offset(s, a->rm),
 -                           vec_full_reg_offset(s, a->ra),
 -                           cpu_env, vsz, vsz, (sel << 1) | sub,
 -                           gen_helper_sve2_fmlal_zzzw_s);
 -    }
 -    return true;
 +    return gen_gvec_ptr_zzzz(s, gen_helper_sve2_fmlal_zzzw_s,
 +                             a->rd, a->rn, a->rm, a->ra,
 +                             (sel << 1) | sub, cpu_env);
  }
  static bool trans_FMLALB_zzzw(DisasContext *s, arg_rrrr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool do_FMLAL_zzxw(DisasContext *s, arg_rrxr_esz *a, bool sub, bool sel)
      if (!dc_isar_feature(aa64_sve2, s)) {
          return false;
      }
 -    if (sve_access_check(s)) {
 -        unsigned vsz = vec_full_reg_size(s);
 -        tcg_gen_gvec_4_ptr(vec_full_reg_offset(s, a->rd),
 -                           vec_full_reg_offset(s, a->rn),
 -                           vec_full_reg_offset(s, a->rm),
 -                           vec_full_reg_offset(s, a->ra),
 -                           cpu_env, vsz, vsz,
 -                           (a->index << 2) | (sel << 1) | sub,
 -                           gen_helper_sve2_fmlal_zzxw_s);
 -    }
 -    return true;
 +    return gen_gvec_ptr_zzzz(s, gen_helper_sve2_fmlal_zzxw_s,
 +                             a->rd, a->rn, a->rm, a->ra,
 +                             (a->index << 2) | (sel << 1) | sub, cpu_env);
  }
  static bool trans_FMLALB_zzxw(DisasContext *s, arg_rrxr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool do_BFMLAL_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sel)
      if (!dc_isar_feature(aa64_sve_bf16, s)) {
          return false;
      }
 -    if (sve_access_check(s)) {
 -        TCGv_ptr status = fpstatus_ptr(FPST_FPCR);
 -        unsigned vsz = vec_full_reg_size(s);
 -
 -        tcg_gen_gvec_4_ptr(vec_full_reg_offset(s, a->rd),
 -                           vec_full_reg_offset(s, a->rn),
 -                           vec_full_reg_offset(s, a->rm),
 -                           vec_full_reg_offset(s, a->ra),
 -                           status, vsz, vsz, sel,
 -                           gen_helper_gvec_bfmlal);
 -        tcg_temp_free_ptr(status);
 -    }
 -    return true;
 +    return gen_gvec_fpst_zzzz(s, gen_helper_gvec_bfmlal,
 +                              a->rd, a->rn, a->rm, a->ra, sel, FPST_FPCR);
  }
  static bool trans_BFMLALB_zzzw(DisasContext *s, arg_rrrr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool do_BFMLAL_zzxw(DisasContext *s, arg_rrxr_esz *a, bool sel)
      if (!dc_isar_feature(aa64_sve_bf16, s)) {
          return false;
      }
 -    if (sve_access_check(s)) {
 -        TCGv_ptr status = fpstatus_ptr(FPST_FPCR);
 -        unsigned vsz = vec_full_reg_size(s);
 -
 -        tcg_gen_gvec_4_ptr(vec_full_reg_offset(s, a->rd),
 -                           vec_full_reg_offset(s, a->rn),
 -                           vec_full_reg_offset(s, a->rm),
 -                           vec_full_reg_offset(s, a->ra),
 -                           status, vsz, vsz, (a->index << 1) | sel,
 -                           gen_helper_gvec_bfmlal_idx);
 -        tcg_temp_free_ptr(status);
 -    }
 -    return true;
 +    return gen_gvec_fpst_zzzz(s, gen_helper_gvec_bfmlal_idx,
 +                              a->rd, a->rn, a->rm, a->ra,
 +                              (a->index << 1) | sel, FPST_FPCR);
  }
  static bool trans_BFMLALB_zzxw(DisasContext *s, arg_rrxr_esz *a)
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 04/45] target/arm: V8M should not imply V7VE
+[PULL 081/117] target/arm: Use TRANS_FEAT for FMMLA
 From: Richard Henderson <richard.henderson@linaro.org>
-Instantiating mps2-an505 (cortex-m33) will fail make check when
+Being able to specify the feature predicate in TRANS_FEAT
-V7VE asserts that ID_ISAR0.Divide includes ARM division.  It is
+makes it easier to split trans_FMMLA by element size,
-also wrong to include ARM_FEATURE_LPAE.
+which also happens to simplify the decode.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181016223115.24100-3-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-79-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.c | 6 +++++-
+ target/arm/sve.decode      |  7 +++----
-file changed, 5 insertions(+), 1 deletion(-)
+ target/arm/translate-sve.c | 27 ++++-----------------------
 files changed, 7 insertions(+), 27 deletions(-)
-diff --git a/target/arm/cpu.c b/target/arm/cpu.c
+diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.c
+--- a/target/arm/sve.decode
-+++ b/target/arm/cpu.c
++++ b/target/arm/sve.decode
-@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
+@@ -XXX,XX +XXX,XX @@ SQRDCMLAH_zzzz  01000100 esz:2 0 rm:5 0011 rot:2 rn:5 rd:5  ra=%reg_movprfx
+ USDOT_zzzz      01000100 .. 0 ..... 011 110 ..... .....  @rda_rn_rm
-     /* Some features automatically imply others: */
-     if (arm_feature(env, ARM_FEATURE_V8)) {
+ ### SVE2 floating point matrix multiply accumulate
--        set_feature(env, ARM_FEATURE_V7VE);
+-{
-+        if (arm_feature(env, ARM_FEATURE_M)) {
+-  BFMMLA        01100100 01 1 ..... 111 001 ..... .....  @rda_rn_rm_e0
-+            set_feature(env, ARM_FEATURE_V7);
+-  FMMLA         01100100 .. 1 ..... 111 001 ..... .....  @rda_rn_rm
-+        } else {
+-}
-+            set_feature(env, ARM_FEATURE_V7VE);
++BFMMLA          01100100 01 1 ..... 111 001 ..... .....  @rda_rn_rm_e0
-+        }
++FMMLA_s         01100100 10 1 ..... 111 001 ..... .....  @rda_rn_rm_e0
-     }
++FMMLA_d         01100100 11 1 ..... 111 001 ..... .....  @rda_rn_rm_e0
-     if (arm_feature(env, ARM_FEATURE_V7VE)) {
-         /* v7 Virtualization Extensions. In real hardware this implies
+ ### SVE2 Memory Gather Load Group
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-sve.c
 +++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ DO_SVE2_ZPZZ_FP(FMINP, fminp)
   * SVE Integer Multiply-Add (unpredicated)
   */
 -static bool trans_FMMLA(DisasContext *s, arg_rrrr_esz *a)
 -{
 -    gen_helper_gvec_4_ptr *fn;
 -
 -    switch (a->esz) {
 -    case MO_32:
 -        if (!dc_isar_feature(aa64_sve_f32mm, s)) {
 -            return false;
 -        }
 -        fn = gen_helper_fmmla_s;
 -        break;
 -    case MO_64:
 -        if (!dc_isar_feature(aa64_sve_f64mm, s)) {
 -            return false;
 -        }
 -        fn = gen_helper_fmmla_d;
 -        break;
 -    default:
 -        return false;
 -    }
 -
 -    return gen_gvec_fpst_zzzz(s, fn, a->rd, a->rn, a->rm, a->ra, 0, FPST_FPCR);
 -}
 +TRANS_FEAT(FMMLA_s, aa64_sve_f32mm, gen_gvec_fpst_zzzz, gen_helper_fmmla_s,
 +           a->rd, a->rn, a->rm, a->ra, 0, FPST_FPCR)
 +TRANS_FEAT(FMMLA_d, aa64_sve_f64mm, gen_gvec_fpst_zzzz, gen_helper_fmmla_d,
 +           a->rd, a->rn, a->rm, a->ra, 0, FPST_FPCR)
  static gen_helper_gvec_4 * const sqdmlal_zzzw_fns[] = {
      NULL,                           gen_helper_sve2_sqdmlal_zzzw_h,
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 41/45] target/arm: Reorg NEON VLD/VST single element to one lane
+[PULL 082/117] target/arm: Move sve check into gen_gvec_fn_ppp
 From: Richard Henderson <richard.henderson@linaro.org>
-Instead of shifts and masks, use direct loads and stores from
+Combined with the check already present in gen_mov_p,
-the neon register file.
+we can simplify some special cases in trans_AND_pppp
 and trans_BIC_pppp.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-21-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-80-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 92 +++++++++++++++++++++++-------------------
+ target/arm/translate-sve.c | 30 ++++++++++++------------------
-file changed, 50 insertions(+), 42 deletions(-)
+file changed, 12 insertions(+), 18 deletions(-)
-diff --git a/target/arm/translate.c b/target/arm/translate.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static TCGv_i32 neon_load_reg(int reg, int pass)
+@@ -XXX,XX +XXX,XX @@ static void do_dupi_z(DisasContext *s, int rd, uint64_t word)
      return tmp;
  }
-+static void neon_load_element(TCGv_i32 var, int reg, int ele, TCGMemOp mop)
+ /* Invoke a vector expander on three Pregs.  */
-+{
+-static void gen_gvec_fn_ppp(DisasContext *s, GVecGen3Fn *gvec_fn,
-+    long offset = neon_element_offset(reg, ele, mop & MO_SIZE);
++static bool gen_gvec_fn_ppp(DisasContext *s, GVecGen3Fn *gvec_fn,
-+
+                             int rd, int rn, int rm)
-+    switch (mop) {
+ {
-+    case MO_UB:
+-    unsigned psz = pred_gvec_reg_size(s);
-+        tcg_gen_ld8u_i32(var, cpu_env, offset);
+-    gvec_fn(MO_64, pred_full_reg_offset(s, rd),
-+        break;
+-            pred_full_reg_offset(s, rn),
-+    case MO_UW:
+-            pred_full_reg_offset(s, rm), psz, psz);
-+        tcg_gen_ld16u_i32(var, cpu_env, offset);
++    if (sve_access_check(s)) {
-+        break;
++        unsigned psz = pred_gvec_reg_size(s);
-+    case MO_UL:
++        gvec_fn(MO_64, pred_full_reg_offset(s, rd),
-+        tcg_gen_ld_i32(var, cpu_env, offset);
++                pred_full_reg_offset(s, rn),
-+        break;
++                pred_full_reg_offset(s, rm), psz, psz);
 +    default:
 +        g_assert_not_reached();
 +    }
-+}
++    return true;
 +
  static void neon_load_element64(TCGv_i64 var, int reg, int ele, TCGMemOp mop)
  {
      long offset = neon_element_offset(reg, ele, mop & MO_SIZE);
@@ -XXX,XX +XXX,XX @@ static void neon_store_reg(int reg, int pass, TCGv_i32 var)
      tcg_temp_free_i32(var);
  }
-+static void neon_store_element(int reg, int ele, TCGMemOp size, TCGv_i32 var)
+ /* Invoke a vector move on two Pregs.  */
-+{
+@@ -XXX,XX +XXX,XX @@ static bool trans_AND_pppp(DisasContext *s, arg_rprr_s *a)
-+    long offset = neon_element_offset(reg, ele, size);
+     };
-+
-+    switch (size) {
+     if (!a->s) {
-+    case MO_8:
+-        if (!sve_access_check(s)) {
-+        tcg_gen_st8_i32(var, cpu_env, offset);
+-            return true;
-+        break;
+-        }
-+    case MO_16:
+         if (a->rn == a->rm) {
-+        tcg_gen_st16_i32(var, cpu_env, offset);
+             if (a->pg == a->rn) {
-+        break;
+-                do_mov_p(s, a->rd, a->rn);
-+    case MO_32:
+-            } else {
-+        tcg_gen_st_i32(var, cpu_env, offset);
+-                gen_gvec_fn_ppp(s, tcg_gen_gvec_and, a->rd, a->rn, a->pg);
-+        break;
++                return do_mov_p(s, a->rd, a->rn);
 +    default:
 +        g_assert_not_reached();
 +    }
 +}
 +
  static void neon_store_element64(int reg, int ele, TCGMemOp size, TCGv_i64 var)
  {
      long offset = neon_element_offset(reg, ele, size);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
      int stride;
      int size;
      int reg;
 -    int pass;
      int load;
 -    int shift;
      int n;
      int vec_size;
      int mmu_idx;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
          } else {
              /* Single element.  */
              int idx = (insn >> 4) & 0xf;
 -            pass = (insn >> 7) & 1;
 +            int reg_idx;
              switch (size) {
              case 0:
 -                shift = ((insn >> 5) & 3) * 8;
 +                reg_idx = (insn >> 5) & 7;
                  stride = 1;
                  break;
              case 1:
 -                shift = ((insn >> 6) & 1) * 16;
 +                reg_idx = (insn >> 6) & 3;
                  stride = (insn & (1 << 5)) ? 2 : 1;
                  break;
              case 2:
 -                shift = 0;
 +                reg_idx = (insn >> 7) & 1;
                  stride = (insn & (1 << 6)) ? 2 : 1;
                  break;
              default:
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
                   */
                  return 1;
              }
-+            tmp = tcg_temp_new_i32();
+-            return true;
-             addr = tcg_temp_new_i32();
++            return gen_gvec_fn_ppp(s, tcg_gen_gvec_and, a->rd, a->rn, a->pg);
-             load_reg_var(s, addr, rn);
+         } else if (a->pg == a->rn || a->pg == a->rm) {
-             for (reg = 0; reg < nregs; reg++) {
+-            gen_gvec_fn_ppp(s, tcg_gen_gvec_and, a->rd, a->rn, a->rm);
-                 if (load) {
+-            return true;
--                    tmp = tcg_temp_new_i32();
++            return gen_gvec_fn_ppp(s, tcg_gen_gvec_and, a->rd, a->rn, a->rm);
 -                    switch (size) {
 -                    case 0:
 -                        gen_aa32_ld8u(s, tmp, addr, get_mem_index(s));
 -                        break;
 -                    case 1:
 -                        gen_aa32_ld16u(s, tmp, addr, get_mem_index(s));
 -                        break;
 -                    case 2:
 -                        gen_aa32_ld32u(s, tmp, addr, get_mem_index(s));
 -                        break;
 -                    default: /* Avoid compiler warnings.  */
 -                        abort();
 -                    }
 -                    if (size != 2) {
 -                        tmp2 = neon_load_reg(rd, pass);
 -                        tcg_gen_deposit_i32(tmp, tmp2, tmp,
 -                                            shift, size ? 16 : 8);
 -                        tcg_temp_free_i32(tmp2);
 -                    }
 -                    neon_store_reg(rd, pass, tmp);
 +                    gen_aa32_ld_i32(s, tmp, addr, get_mem_index(s),
 +                                    s->be_data | size);
 +                    neon_store_element(rd, reg_idx, size, tmp);
                  } else { /* Store */
 -                    tmp = neon_load_reg(rd, pass);
 -                    if (shift)
 -                        tcg_gen_shri_i32(tmp, tmp, shift);
 -                    switch (size) {
 -                    case 0:
 -                        gen_aa32_st8(s, tmp, addr, get_mem_index(s));
 -                        break;
 -                    case 1:
 -                        gen_aa32_st16(s, tmp, addr, get_mem_index(s));
 -                        break;
 -                    case 2:
 -                        gen_aa32_st32(s, tmp, addr, get_mem_index(s));
 -                        break;
 -                    }
 -                    tcg_temp_free_i32(tmp);
 +                    neon_load_element(tmp, rd, reg_idx, size);
 +                    gen_aa32_st_i32(s, tmp, addr, get_mem_index(s),
 +                                    s->be_data | size);
                  }
                  rd += stride;
                  tcg_gen_addi_i32(addr, addr, 1 << size);
              }
              tcg_temp_free_i32(addr);
 +            tcg_temp_free_i32(tmp);
              stride = nregs * (1 << size);
          }
      }
+     return do_pppp_flags(s, a, &op);
+@@ -XXX,XX +XXX,XX @@ static bool trans_BIC_pppp(DisasContext *s, arg_rprr_s *a)
+     };
+     if (!a->s && a->pg == a->rn) {
+-        if (sve_access_check(s)) {
+-            gen_gvec_fn_ppp(s, tcg_gen_gvec_andc, a->rd, a->rn, a->rm);
+-        }
+-        return true;
++        return gen_gvec_fn_ppp(s, tcg_gen_gvec_andc, a->rd, a->rn, a->rm);
+     }
+     return do_pppp_flags(s, a, &op);
+ }
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 21/45] hw/arm/boot: Increase compliance with kernel arm64 boot protocol
+[PULL 083/117] target/arm: Implement NOT (prediates) alias
-From: Stewart Hildebrand <Stewart.Hildebrand@dornerworks.com>
+From: Richard Henderson <richard.henderson@linaro.org>
-"The Image must be placed text_offset bytes from a 2MB aligned base
+This alias is defined on EOR (prediates).  While the
-address anywhere in usable system RAM and called there."
+same operation could be performed with NAND or NOR,
 only bother with the official alias.
-For the virt board, we write our startup bootloader at the very
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-bottom of RAM, so that bit can't be used for the image. To avoid
+Message-id: 20220527181907.189259-81-richard.henderson@linaro.org
 overlap in case the image requests to be loaded at an offset
 smaller than our bootloader, we increment the load offset to the
 next 2MB.
 This fixes a boot failure for Xen AArch64.
 Signed-off-by: Stewart Hildebrand <stewart.hildebrand@dornerworks.com>
 Tested-by: Andre Przywara <andre.przywara@arm.com>
 Message-id: b8a89518794b4436af0c151ed10de4fa@dornerworks.com
 [PMM: Rephrased a comment a bit]
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- hw/arm/boot.c | 18 ++++++++++++++++++
+ target/arm/translate-sve.c | 5 +++++
-file changed, 18 insertions(+)
+file changed, 5 insertions(+)
-diff --git a/hw/arm/boot.c b/hw/arm/boot.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/hw/arm/boot.c
+--- a/target/arm/translate-sve.c
-+++ b/hw/arm/boot.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@
+@@ -XXX,XX +XXX,XX @@ static bool trans_EOR_pppp(DisasContext *s, arg_rprr_s *a)
- #include "qemu/config-file.h"
+         .fno = gen_helper_sve_eor_pppp,
- #include "qemu/option.h"
+         .prefer_i64 = TCG_TARGET_REG_BITS == 64,
- #include "exec/address-spaces.h"
+     };
 +#include "qemu/units.h"
  /* Kernel boot protocol is specified in the kernel docs
   * Documentation/arm/Booting and Documentation/arm64/booting.txt
@@ -XXX,XX +XXX,XX @@
  #define ARM64_TEXT_OFFSET_OFFSET    8
  #define ARM64_MAGIC_OFFSET          56
 +#define BOOTLOADER_MAX_SIZE         (4 * KiB)
 +
- AddressSpace *arm_boot_address_space(ARMCPU *cpu,
++    /* Alias NOT (predicate) is EOR Pd.B, Pg/Z, Pn.B, Pg.B */
-                                      const struct arm_boot_info *info)
++    if (!a->s && a->pg == a->rm) {
- {
++        return gen_gvec_fn_ppp(s, tcg_gen_gvec_andc, a->rd, a->pg, a->rn);
-@@ -XXX,XX +XXX,XX @@ static void write_bootloader(const char *name, hwaddr addr,
++    }
-         code[i] = tswap32(insn);
+     return do_pppp_flags(s, a, &op);
-     }
+ }
 +    assert((len * sizeof(uint32_t)) < BOOTLOADER_MAX_SIZE);
 +
      rom_add_blob_fixed_as(name, code, len * sizeof(uint32_t), addr, as);
      g_free(code);
@@ -XXX,XX +XXX,XX @@ static uint64_t load_aarch64_image(const char *filename, hwaddr mem_base,
          memcpy(&hdrvals, buffer + ARM64_TEXT_OFFSET_OFFSET, sizeof(hdrvals));
          if (hdrvals[1] != 0) {
              kernel_load_offset = le64_to_cpu(hdrvals[0]);
 +
 +            /*
 +             * We write our startup "bootloader" at the very bottom of RAM,
 +             * so that bit can't be used for the image. Luckily the Image
 +             * format specification is that the image requests only an offset
 +             * from a 2MB boundary, not an absolute load address. So if the
 +             * image requests an offset that might mean it overlaps with the
 +             * bootloader, we can just load it starting at 2MB+offset rather
 +             * than 0MB + offset.
 +             */
 +            if (kernel_load_offset < BOOTLOADER_MAX_SIZE) {
 +                kernel_load_offset += 2 * MiB;
 +            }
          }
      }
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 42/45] net: cadence_gem: Announce availability of priority queues
+[PULL 084/117] target/arm: Use TRANS_FEAT for SEL_zpzz
-From: "Edgar E. Iglesias" <edgar.iglesias@xilinx.com>
+From: Richard Henderson <richard.henderson@linaro.org>
-Announce the availability of the various priority queues.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-This fixes an issue where guest kernels would miss to
+Message-id: 20220527181907.189259-82-richard.henderson@linaro.org
 configure secondary queues due to inproper feature bits.
 Signed-off-by: Edgar E. Iglesias <edgar.iglesias@xilinx.com>
 Message-id: 20181017213932.19973-2-edgar.iglesias@gmail.com
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- hw/net/cadence_gem.c | 8 +++++++-
+ target/arm/translate-sve.c | 5 +----
-file changed, 7 insertions(+), 1 deletion(-)
+file changed, 1 insertion(+), 4 deletions(-)
-diff --git a/hw/net/cadence_gem.c b/hw/net/cadence_gem.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/hw/net/cadence_gem.c
+--- a/target/arm/translate-sve.c
-+++ b/hw/net/cadence_gem.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static void gem_reset(DeviceState *d)
+@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_4 * const udiv_fns[4] = {
-     int i;
+ };
-     CadenceGEMState *s = CADENCE_GEM(d);
+ TRANS_FEAT(UDIV_zpzz, aa64_sve, gen_gvec_ool_arg_zpzz, udiv_fns[a->esz], a, 0)
-     const uint8_t *a;
-+    uint32_t queues_mask = 0;
+-static bool trans_SEL_zpzz(DisasContext *s, arg_rprr_esz *a)
+-{
-     DB_PRINT("\n");
+-    return do_sel_z(s, a->rd, a->rn, a->rm, a->pg, a->esz);
+-}
-@@ -XXX,XX +XXX,XX @@ static void gem_reset(DeviceState *d)
++TRANS_FEAT(SEL_zpzz, aa64_sve, do_sel_z, a->rd, a->rn, a->rm, a->pg, a->esz)
-     s->regs[GEM_DESCONF] = 0x02500111;
-     s->regs[GEM_DESCONF2] = 0x2ab13fff;
+ /*
-     s->regs[GEM_DESCONF5] = 0x002f2045;
+  *** SVE Integer Arithmetic - Unary Predicated Group
 -    s->regs[GEM_DESCONF6] = 0x00000200;
 +    s->regs[GEM_DESCONF6] = 0x0;
 +
 +    if (s->num_priority_queues > 1) {
 +        queues_mask = MAKE_64BIT_MASK(1, s->num_priority_queues - 1);
 +        s->regs[GEM_DESCONF6] |= queues_mask;
 +    }
      /* Set MAC address */
      a = &s->conf.macaddr.a[0];
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 32/45] target/arm: Use gvec for NEON_3R_VMUL
+[PULL 085/117] target/arm: Use TRANS_FEAT for MOVPRFX
 From: Richard Henderson <richard.henderson@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-12-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-83-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 31 +++++++++++++++----------------
+ target/arm/translate-sve.c | 17 +++--------------
-file changed, 15 insertions(+), 16 deletions(-)
+file changed, 3 insertions(+), 14 deletions(-)
-diff --git a/target/arm/translate.c b/target/arm/translate.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static bool trans_PRF_rr(DisasContext *s, arg_PRF_rr *a)
-                                  vec_size, vec_size);
+  * In the meantime, just emit the moves.
-             }
+  */
-             return 0;
-+
+-static bool trans_MOVPRFX(DisasContext *s, arg_MOVPRFX *a)
-+        case NEON_3R_VMUL: /* VMUL */
+-{
-+            if (u) {
+-    return do_mov_z(s, a->rd, a->rn);
-+                /* Polynomial case allows only P8 and is handled below.  */
+-}
-+                if (size != 0) {
+-
-+                    return 1;
+-static bool trans_MOVPRFX_m(DisasContext *s, arg_rpr_esz *a)
-+                }
+-{
-+            } else {
+-    return do_sel_z(s, a->rd, a->rn, a->rd, a->pg, a->esz);
-+                tcg_gen_gvec_mul(size, rd_ofs, rn_ofs, rm_ofs,
+-}
-+                                 vec_size, vec_size);
+-
-+                return 0;
+-static bool trans_MOVPRFX_z(DisasContext *s, arg_rpr_esz *a)
-+            }
+-{
-+            break;
+-    return do_movz_zpz(s, a->rd, a->rn, a->pg, a->esz, false);
-         }
+-}
-         if (size == 3) {
++TRANS_FEAT(MOVPRFX, aa64_sve, do_mov_z, a->rd, a->rn)
-             /* 64-bit element instructions. */
++TRANS_FEAT(MOVPRFX_m, aa64_sve, do_sel_z, a->rd, a->rn, a->rd, a->pg, a->esz)
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
++TRANS_FEAT(MOVPRFX_z, aa64_sve, do_movz_zpz, a->rd, a->rn, a->pg, a->esz, false)
-                 return 1;
-             }
+ /*
-             break;
+  * SVE2 Integer Multiply - Unpredicated
 -        case NEON_3R_VMUL:
 -            if (u && (size != 0)) {
 -                /* UNDEF on invalid size for polynomial subcase */
 -                return 1;
 -            }
 -            break;
          case NEON_3R_VFM_VQRDMLSH:
              if (!arm_dc_feature(s, ARM_FEATURE_VFP4)) {
                  return 1;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
              }
              break;
          case NEON_3R_VMUL:
 -            if (u) { /* polynomial */
 -                gen_helper_neon_mul_p8(tmp, tmp, tmp2);
 -            } else { /* Integer */
 -                switch (size) {
 -                case 0: gen_helper_neon_mul_u8(tmp, tmp, tmp2); break;
 -                case 1: gen_helper_neon_mul_u16(tmp, tmp, tmp2); break;
 -                case 2: tcg_gen_mul_i32(tmp, tmp, tmp2); break;
 -                default: abort();
 -                }
 -            }
 +            /* VMUL.P8; other cases already eliminated.  */
 +            gen_helper_neon_mul_p8(tmp, tmp, tmp2);
              break;
          case NEON_3R_VPMAX:
              GEN_NEON_INTEGER_OP(pmax);
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 31/45] target/arm: Use gvec for NEON_2RM_VMN, NEON_2RM_VNEG
+[PULL 086/117] target/arm: Use TRANS_FEAT for FMLA
 From: Richard Henderson <richard.henderson@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-11-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-84-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 16 ++++++++--------
+ target/arm/translate-sve.c | 11 ++---------
-file changed, 8 insertions(+), 8 deletions(-)
+file changed, 2 insertions(+), 9 deletions(-)
-diff --git a/target/arm/translate.c b/target/arm/translate.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static bool do_FMLA_zzxz(DisasContext *s, arg_rrxr_esz *a, bool sub)
-                     tcg_temp_free_ptr(ptr1);
+                               a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
-                     tcg_temp_free_ptr(ptr2);
+ }
-                     break;
-+
+-static bool trans_FMLA_zzxz(DisasContext *s, arg_FMLA_zzxz *a)
-+                case NEON_2RM_VMVN:
+-{
-+                    tcg_gen_gvec_not(0, rd_ofs, rm_ofs, vec_size, vec_size);
+-    return do_FMLA_zzxz(s, a, false);
-+                    break;
+-}
-+                case NEON_2RM_VNEG:
+-
-+                    tcg_gen_gvec_neg(size, rd_ofs, rm_ofs, vec_size, vec_size);
+-static bool trans_FMLS_zzxz(DisasContext *s, arg_FMLA_zzxz *a)
-+                    break;
+-{
-+
+-    return do_FMLA_zzxz(s, a, true);
-                 default:
+-}
-                 elementwise:
++TRANS_FEAT(FMLA_zzxz, aa64_sve, do_FMLA_zzxz, a, false)
-                     for (pass = 0; pass < (q ? 4 : 2); pass++) {
++TRANS_FEAT(FMLS_zzxz, aa64_sve, do_FMLA_zzxz, a, true)
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
-                         case NEON_2RM_VCNT:
+ /*
-                             gen_helper_neon_cnt_u8(tmp, tmp);
+  *** SVE Floating Point Multiply Indexed Group
                              break;
 -                        case NEON_2RM_VMVN:
 -                            tcg_gen_not_i32(tmp, tmp);
 -                            break;
                          case NEON_2RM_VQABS:
                              switch (size) {
                              case 0:
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                              default: abort();
                              }
                              break;
 -                        case NEON_2RM_VNEG:
 -                            tmp2 = tcg_const_i32(0);
 -                            gen_neon_rsb(size, tmp, tmp2);
 -                            tcg_temp_free_i32(tmp2);
 -                            break;
                          case NEON_2RM_VCGT0_F:
                          {
                              TCGv_ptr fpstatus = get_fpstatus_ptr(1);
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 38/45] target/arm: Use gvec for NEON VLD all lanes
+[PULL 087/117] target/arm: Use TRANS_FEAT for BFMLA
 From: Richard Henderson <richard.henderson@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-18-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-85-richard.henderson@linaro.org
 [PMM: added parens in ?: expression]
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 81 ++++++++++++++----------------------------
+ target/arm/translate-sve.c | 28 ++++------------------------
-file changed, 26 insertions(+), 55 deletions(-)
+file changed, 4 insertions(+), 24 deletions(-)
-diff --git a/target/arm/translate.c b/target/arm/translate.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static void gen_vfp_msr(TCGv_i32 tmp)
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(BFMMLA, aa64_sve_bf16, gen_gvec_ool_arg_zzzz,
-     tcg_temp_free_i32(tmp);
  static bool do_BFMLAL_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sel)
  {
 -    if (!dc_isar_feature(aa64_sve_bf16, s)) {
 -        return false;
 -    }
      return gen_gvec_fpst_zzzz(s, gen_helper_gvec_bfmlal,
                                a->rd, a->rn, a->rm, a->ra, sel, FPST_FPCR);
  }
--static void gen_neon_dup_u8(TCGv_i32 var, int shift)
+-static bool trans_BFMLALB_zzzw(DisasContext *s, arg_rrrr_esz *a)
 -{
--    TCGv_i32 tmp = tcg_temp_new_i32();
+-    return do_BFMLAL_zzzw(s, a, false);
 -    if (shift)
 -        tcg_gen_shri_i32(var, var, shift);
 -    tcg_gen_ext8u_i32(var, var);
 -    tcg_gen_shli_i32(tmp, var, 8);
 -    tcg_gen_or_i32(var, var, tmp);
 -    tcg_gen_shli_i32(tmp, var, 16);
 -    tcg_gen_or_i32(var, var, tmp);
 -    tcg_temp_free_i32(tmp);
 -}
 -
- static void gen_neon_dup_low16(TCGv_i32 var)
+-static bool trans_BFMLALT_zzzw(DisasContext *s, arg_rrrr_esz *a)
 -{
 -    return do_BFMLAL_zzzw(s, a, true);
 -}
 +TRANS_FEAT(BFMLALB_zzzw, aa64_sve_bf16, do_BFMLAL_zzzw, a, false)
 +TRANS_FEAT(BFMLALT_zzzw, aa64_sve_bf16, do_BFMLAL_zzzw, a, true)
  static bool do_BFMLAL_zzxw(DisasContext *s, arg_rrxr_esz *a, bool sel)
  {
-     TCGv_i32 tmp = tcg_temp_new_i32();
+-    if (!dc_isar_feature(aa64_sve_bf16, s)) {
-@@ -XXX,XX +XXX,XX @@ static void gen_neon_dup_high16(TCGv_i32 var)
+-        return false;
-     tcg_temp_free_i32(tmp);
+-    }
      return gen_gvec_fpst_zzzz(s, gen_helper_gvec_bfmlal_idx,
                                a->rd, a->rn, a->rm, a->ra,
                                (a->index << 1) | sel, FPST_FPCR);
  }
--static TCGv_i32 gen_load_and_replicate(DisasContext *s, TCGv_i32 addr, int size)
+-static bool trans_BFMLALB_zzxw(DisasContext *s, arg_rrxr_esz *a)
 -{
--    /* Load a single Neon element and replicate into a 32 bit TCG reg */
+-    return do_BFMLAL_zzxw(s, a, false);
 -    TCGv_i32 tmp = tcg_temp_new_i32();
 -    switch (size) {
 -    case 0:
 -        gen_aa32_ld8u(s, tmp, addr, get_mem_index(s));
 -        gen_neon_dup_u8(tmp, 0);
 -        break;
 -    case 1:
 -        gen_aa32_ld16u(s, tmp, addr, get_mem_index(s));
 -        gen_neon_dup_low16(tmp);
 -        break;
 -    case 2:
 -        gen_aa32_ld32u(s, tmp, addr, get_mem_index(s));
 -        break;
 -    default: /* Avoid compiler warnings.  */
 -        abort();
 -    }
 -    return tmp;
 -}
 -
- static int handle_vsel(uint32_t insn, uint32_t rd, uint32_t rn, uint32_t rm,
+-static bool trans_BFMLALT_zzxw(DisasContext *s, arg_rrxr_esz *a)
-                        uint32_t dp)
+-{
- {
+-    return do_BFMLAL_zzxw(s, a, true);
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
+-}
-     int load;
++TRANS_FEAT(BFMLALB_zzxw, aa64_sve_bf16, do_BFMLAL_zzxw, a, false)
-     int shift;
++TRANS_FEAT(BFMLALT_zzxw, aa64_sve_bf16, do_BFMLAL_zzxw, a, true)
      int n;
 +    int vec_size;
      TCGv_i32 addr;
      TCGv_i32 tmp;
      TCGv_i32 tmp2;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
              }
              addr = tcg_temp_new_i32();
              load_reg_var(s, addr, rn);
 -            if (nregs == 1) {
 -                /* VLD1 to all lanes: bit 5 indicates how many Dregs to write */
 -                tmp = gen_load_and_replicate(s, addr, size);
 -                tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd, 0));
 -                tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd, 1));
 -                if (insn & (1 << 5)) {
 -                    tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd + 1, 0));
 -                    tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd + 1, 1));
 -                }
 -                tcg_temp_free_i32(tmp);
 -            } else {
 -                /* VLD2/3/4 to all lanes: bit 5 indicates register stride */
 -                stride = (insn & (1 << 5)) ? 2 : 1;
 -                for (reg = 0; reg < nregs; reg++) {
 -                    tmp = gen_load_and_replicate(s, addr, size);
 -                    tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd, 0));
 -                    tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd, 1));
 -                    tcg_temp_free_i32(tmp);
 -                    tcg_gen_addi_i32(addr, addr, 1 << size);
 -                    rd += stride;
 +
 +            /* VLD1 to all lanes: bit 5 indicates how many Dregs to write.
 +             * VLD2/3/4 to all lanes: bit 5 indicates register stride.
 +             */
 +            stride = (insn & (1 << 5)) ? 2 : 1;
 +            vec_size = nregs == 1 ? stride * 8 : 8;
 +
 +            tmp = tcg_temp_new_i32();
 +            for (reg = 0; reg < nregs; reg++) {
 +                gen_aa32_ld_i32(s, tmp, addr, get_mem_index(s),
 +                                s->be_data | size);
 +                if ((rd & 1) && vec_size == 16) {
 +                    /* We cannot write 16 bytes at once because the
 +                     * destination is unaligned.
 +                     */
 +                    tcg_gen_gvec_dup_i32(size, neon_reg_offset(rd, 0),
 +                                         8, 8, tmp);
 +                    tcg_gen_gvec_mov(0, neon_reg_offset(rd + 1, 0),
 +                                     neon_reg_offset(rd, 0), 8, 8);
 +                } else {
 +                    tcg_gen_gvec_dup_i32(size, neon_reg_offset(rd, 0),
 +                                         vec_size, vec_size, tmp);
                  }
 +                tcg_gen_addi_i32(addr, addr, 1 << size);
 +                rd += stride;
              }
 +            tcg_temp_free_i32(tmp);
              tcg_temp_free_i32(addr);
              stride = (1 << size) * nregs;
          } else {
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 07/45] target/arm: Convert jazelle from feature bit to isar1 test
+[PULL 088/117] target/arm: Rename do_zzz_fp to gen_gvec_ool_fpst_arg_zzz
 From: Richard Henderson <richard.henderson@linaro.org>
-Having V6 alone imply jazelle was wrong for cortex-m0.
+Rename the function to match gen_gvec_ool_arg_zzz,
-Change to an assertion for V6 & !M.
+and move to be adjacent.  Split out gen_gvec_fpst_zzz
 as a helper while we're at it.
-This was harmless, because the only place we tested ARM_FEATURE_JAZELLE
-was for 'bxj' in disas_arm(), which is unreachable for M-profile cores.
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181016223115.24100-6-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-86-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.h       |  6 +++++-
+ target/arm/translate-sve.c | 50 +++++++++++++++++++++++---------------
- target/arm/cpu.c       | 17 ++++++++++++++---
+file changed, 30 insertions(+), 20 deletions(-)
  target/arm/translate.c |  2 +-
 files changed, 20 insertions(+), 5 deletions(-)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/cpu.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ enum arm_features {
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_arg_zzz(DisasContext *s, gen_helper_gvec_3 *fn,
-     ARM_FEATURE_PMU, /* has PMU support */
+     return gen_gvec_ool_zzz(s, fn, a->rd, a->rn, a->rm, data);
      ARM_FEATURE_VBAR, /* has cp15 VBAR */
      ARM_FEATURE_M_SECURITY, /* M profile Security Extension */
 -    ARM_FEATURE_JAZELLE, /* has (trivial) Jazelle implementation */
      ARM_FEATURE_SVE, /* has Scalable Vector Extension */
      ARM_FEATURE_V8_FP16, /* implements v8.2 half-precision float */
      ARM_FEATURE_M_MAIN, /* M profile Main Extension */
@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_arm_div(const ARMISARegisters *id)
      return FIELD_EX32(id->id_isar0, ID_ISAR0, DIVIDE) > 1;
  }
-+static inline bool isar_feature_jazelle(const ARMISARegisters *id)
++/* Invoke an out-of-line helper on 3 Zregs, plus float_status. */
 +static bool gen_gvec_fpst_zzz(DisasContext *s, gen_helper_gvec_3_ptr *fn,
 +                              int rd, int rn, int rm,
 +                              int data, ARMFPStatusFlavour flavour)
 +{
-+    return FIELD_EX32(id->id_isar1, ID_ISAR1, JAZELLE) != 0;
++    if (fn == NULL) {
 +        return false;
 +    }
 +    if (sve_access_check(s)) {
 +        unsigned vsz = vec_full_reg_size(s);
 +        TCGv_ptr status = fpstatus_ptr(flavour);
 +
 +        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, rd),
 +                           vec_full_reg_offset(s, rn),
 +                           vec_full_reg_offset(s, rm),
 +                           status, vsz, vsz, data, fn);
 +
 +        tcg_temp_free_ptr(status);
 +    }
 +    return true;
 +}
 +
- static inline bool isar_feature_aa32_aes(const ARMISARegisters *id)
++static bool gen_gvec_fpst_arg_zzz(DisasContext *s, gen_helper_gvec_3_ptr *fn,
- {
++                                  arg_rrr_esz *a, int data)
-     return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) != 0;
++{
-diff --git a/target/arm/cpu.c b/target/arm/cpu.c
++    return gen_gvec_fpst_zzz(s, fn, a->rd, a->rn, a->rm, data,
-index XXXXXXX..XXXXXXX 100644
++                             a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
---- a/target/arm/cpu.c
++}
 +++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
      }
      if (arm_feature(env, ARM_FEATURE_V6)) {
          set_feature(env, ARM_FEATURE_V5);
 -        set_feature(env, ARM_FEATURE_JAZELLE);
          if (!arm_feature(env, ARM_FEATURE_M)) {
 +            assert(cpu_isar_feature(jazelle, cpu));
              set_feature(env, ARM_FEATURE_AUXCR);
          }
      }
@@ -XXX,XX +XXX,XX @@ static void arm926_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_VFP);
      set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
      set_feature(&cpu->env, ARM_FEATURE_CACHE_TEST_CLEAN);
 -    set_feature(&cpu->env, ARM_FEATURE_JAZELLE);
      cpu->midr = 0x41069265;
      cpu->reset_fpsid = 0x41011090;
      cpu->ctr = 0x1dd20d2;
      cpu->reset_sctlr = 0x00090078;
 +
-+    /*
+ /* Invoke an out-of-line helper on 4 Zregs. */
-+     * ARMv5 does not have the ID_ISAR registers, but we can still
+ static bool gen_gvec_ool_zzzz(DisasContext *s, gen_helper_gvec_4 *fn,
-+     * set the field to indicate Jazelle support within QEMU.
+                               int rd, int rn, int rm, int ra, int data)
-+     */
+@@ -XXX,XX +XXX,XX @@ static bool trans_FADDA(DisasContext *s, arg_rprr_esz *a)
-+    cpu->isar.id_isar1 = FIELD_DP32(cpu->isar.id_isar1, ID_ISAR1, JAZELLE, 1);
+  *** SVE Floating Point Arithmetic - Unpredicated Group
   */
 -static bool do_zzz_fp(DisasContext *s, arg_rrr_esz *a,
 -                      gen_helper_gvec_3_ptr *fn)
 -{
 -    if (fn == NULL) {
 -        return false;
 -    }
 -    if (sve_access_check(s)) {
 -        unsigned vsz = vec_full_reg_size(s);
 -        TCGv_ptr status = fpstatus_ptr(a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
 -        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, a->rd),
 -                           vec_full_reg_offset(s, a->rn),
 -                           vec_full_reg_offset(s, a->rm),
 -                           status, vsz, vsz, 0, fn);
 -        tcg_temp_free_ptr(status);
 -    }
 -    return true;
 -}
 -
 -
  #define DO_FP3(NAME, name) \
  static bool trans_##NAME(DisasContext *s, arg_rrr_esz *a)           \
  {                                                                   \
@@ -XXX,XX +XXX,XX @@ static bool trans_##NAME(DisasContext *s, arg_rrr_esz *a)           \
          NULL, gen_helper_gvec_##name##_h,                           \
          gen_helper_gvec_##name##_s, gen_helper_gvec_##name##_d      \
      };                                                              \
 -    return do_zzz_fp(s, a, fns[a->esz]);                            \
 +    return gen_gvec_fpst_arg_zzz(s, fns[a->esz], a, 0);             \
  }
- static void arm946_initfn(Object *obj)
+ DO_FP3(FADD_zzz, fadd)
@@ -XXX,XX +XXX,XX @@ static void arm1026_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_AUXCR);
      set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
      set_feature(&cpu->env, ARM_FEATURE_CACHE_TEST_CLEAN);
 -    set_feature(&cpu->env, ARM_FEATURE_JAZELLE);
      cpu->midr = 0x4106a262;
      cpu->reset_fpsid = 0x410110a0;
      cpu->ctr = 0x1dd20d2;
      cpu->reset_sctlr = 0x00090078;
      cpu->reset_auxcr = 1;
 +
 +    /*
 +     * ARMv5 does not have the ID_ISAR registers, but we can still
 +     * set the field to indicate Jazelle support within QEMU.
 +     */
 +    cpu->isar.id_isar1 = FIELD_DP32(cpu->isar.id_isar1, ID_ISAR1, JAZELLE, 1);
 +
      {
          /* The 1026 had an IFAR at c6,c0,0,1 rather than the ARMv6 c6,c0,0,2 */
          ARMCPRegInfo ifar = {
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@
  #define ENABLE_ARCH_5     arm_dc_feature(s, ARM_FEATURE_V5)
  /* currently all emulated v5 cores are also v5TE, so don't bother */
  #define ENABLE_ARCH_5TE   arm_dc_feature(s, ARM_FEATURE_V5)
 -#define ENABLE_ARCH_5J    arm_dc_feature(s, ARM_FEATURE_JAZELLE)
 +#define ENABLE_ARCH_5J    dc_isar_feature(jazelle, s)
  #define ENABLE_ARCH_6     arm_dc_feature(s, ARM_FEATURE_V6)
  #define ENABLE_ARCH_6K    arm_dc_feature(s, ARM_FEATURE_V6K)
  #define ENABLE_ARCH_6T2   arm_dc_feature(s, ARM_FEATURE_THUMB2)
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 30/45] target/arm: Use gvec for NEON_3R_VADD_VSUB insns
+[PULL 089/117] target/arm: Use TRANS_FEAT for DO_FP3
 From: Richard Henderson <richard.henderson@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-10-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-87-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 29 ++++++++++-------------------
+ target/arm/translate-sve.c | 7 ++-----
-file changed, 10 insertions(+), 19 deletions(-)
+file changed, 2 insertions(+), 5 deletions(-)
-diff --git a/target/arm/translate.c b/target/arm/translate.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static bool trans_FADDA(DisasContext *s, arg_rprr_esz *a)
-                 break;
+  */
-             }
-             return 0;
+ #define DO_FP3(NAME, name) \
-+
+-static bool trans_##NAME(DisasContext *s, arg_rrr_esz *a)           \
-+        case NEON_3R_VADD_VSUB:
+-{                                                                   \
-+            if (u) {
+-    static gen_helper_gvec_3_ptr * const fns[4] = {                 \
-+                tcg_gen_gvec_sub(size, rd_ofs, rn_ofs, rm_ofs,
++    static gen_helper_gvec_3_ptr * const name##_fns[4] = {          \
-+                                 vec_size, vec_size);
+         NULL, gen_helper_gvec_##name##_h,                           \
-+            } else {
+         gen_helper_gvec_##name##_s, gen_helper_gvec_##name##_d      \
-+                tcg_gen_gvec_add(size, rd_ofs, rn_ofs, rm_ofs,
+     };                                                              \
-+                                 vec_size, vec_size);
+-    return gen_gvec_fpst_arg_zzz(s, fns[a->esz], a, 0);             \
-+            }
+-}
-+            return 0;
++    TRANS_FEAT(NAME, aa64_sve, gen_gvec_fpst_arg_zzz, name##_fns[a->esz], a, 0)
-         }
-         if (size == 3) {
+ DO_FP3(FADD_zzz, fadd)
-             /* 64-bit element instructions. */
+ DO_FP3(FSUB_zzz, fsub)
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                                                    cpu_V1, cpu_V0);
                      }
                      break;
 -                case NEON_3R_VADD_VSUB:
 -                    if (u) {
 -                        tcg_gen_sub_i64(CPU_V001);
 -                    } else {
 -                        tcg_gen_add_i64(CPU_V001);
 -                    }
 -                    break;
                  default:
                      abort();
                  }
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
              tmp2 = neon_load_reg(rd, pass);
              gen_neon_add(size, tmp, tmp2);
              break;
 -        case NEON_3R_VADD_VSUB:
 -            if (!u) { /* VADD */
 -                gen_neon_add(size, tmp, tmp2);
 -            } else { /* VSUB */
 -                switch (size) {
 -                case 0: gen_helper_neon_sub_u8(tmp, tmp, tmp2); break;
 -                case 1: gen_helper_neon_sub_u16(tmp, tmp, tmp2); break;
 -                case 2: tcg_gen_sub_i32(tmp, tmp, tmp2); break;
 -                default: abort();
 -                }
 -            }
 -            break;
          case NEON_3R_VTST_VCEQ:
              if (!u) { /* VTST */
                  switch (size) {
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 28/45] target/arm: Use gvec for NEON VMOV, VMVN, VBIC & VORR (immediate)
+[PULL 090/117] target/arm: Use TRANS_FEAT for FMUL_zzx
 From: Richard Henderson <richard.henderson@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-8-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-88-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 67 ++++++++++++++++++++++++------------------
+ target/arm/translate-sve.c | 26 +++++++-------------------
-file changed, 39 insertions(+), 28 deletions(-)
+file changed, 7 insertions(+), 19 deletions(-)
-diff --git a/target/arm/translate.c b/target/arm/translate.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(FMLS_zzxz, aa64_sve, do_FMLA_zzxz, a, true)
-                 return 1;
+  *** SVE Floating Point Multiply Indexed Group
-             }
+  */
-         } else { /* (insn & 0x00380080) == 0 */
--            int invert;
+-static bool trans_FMUL_zzx(DisasContext *s, arg_FMUL_zzx *a)
-+            int invert, reg_ofs, vec_size;
+-{
-+
+-    static gen_helper_gvec_3_ptr * const fns[3] = {
-             if (q && (rd & 1)) {
+-        gen_helper_gvec_fmul_idx_h,
-                 return 1;
+-        gen_helper_gvec_fmul_idx_s,
-             }
+-        gen_helper_gvec_fmul_idx_d,
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+-    };
-                 break;
+-
-             case 14:
+-    if (sve_access_check(s)) {
-                 imm |= (imm << 8) | (imm << 16) | (imm << 24);
+-        unsigned vsz = vec_full_reg_size(s);
--                if (invert)
+-        TCGv_ptr status = fpstatus_ptr(a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
-+                if (invert) {
+-        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, a->rd),
-                     imm = ~imm;
+-                           vec_full_reg_offset(s, a->rn),
-+                }
+-                           vec_full_reg_offset(s, a->rm),
-                 break;
+-                           status, vsz, vsz, a->index, fns[a->esz - 1]);
-             case 15:
+-        tcg_temp_free_ptr(status);
-                 if (invert) {
+-    }
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+-    return true;
-                       | ((imm & 0x40) ? (0x1f << 25) : (1 << 30));
+-}
-                 break;
++static gen_helper_gvec_3_ptr * const fmul_idx_fns[4] = {
-             }
++    NULL,                       gen_helper_gvec_fmul_idx_h,
--            if (invert)
++    gen_helper_gvec_fmul_idx_s, gen_helper_gvec_fmul_idx_d,
-+            if (invert) {
++};
-                 imm = ~imm;
++TRANS_FEAT(FMUL_zzx, aa64_sve, gen_gvec_fpst_zzz,
-+            }
++           fmul_idx_fns[a->esz], a->rd, a->rn, a->rm, a->index,
++           a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR)
--            for (pass = 0; pass < (q ? 4 : 2); pass++) {
--                if (op & 1 && op < 12) {
+ /*
--                    tmp = neon_load_reg(rd, pass);
+  *** SVE Floating Point Fast Reduction Group
 -                    if (invert) {
 -                        /* The immediate value has already been inverted, so
 -                           BIC becomes AND.  */
 -                        tcg_gen_andi_i32(tmp, tmp, imm);
 -                    } else {
 -                        tcg_gen_ori_i32(tmp, tmp, imm);
 -                    }
 +            reg_ofs = neon_reg_offset(rd, 0);
 +            vec_size = q ? 16 : 8;
 +
 +            if (op & 1 && op < 12) {
 +                if (invert) {
 +                    /* The immediate value has already been inverted,
 +                     * so BIC becomes AND.
 +                     */
 +                    tcg_gen_gvec_andi(MO_32, reg_ofs, reg_ofs, imm,
 +                                      vec_size, vec_size);
                  } else {
 -                    /* VMOV, VMVN.  */
 -                    tmp = tcg_temp_new_i32();
 -                    if (op == 14 && invert) {
 -                        int n;
 -                        uint32_t val;
 -                        val = 0;
 -                        for (n = 0; n < 4; n++) {
 -                            if (imm & (1 << (n + (pass & 1) * 4)))
 -                                val |= 0xff << (n * 8);
 -                        }
 -                        tcg_gen_movi_i32(tmp, val);
 -                    } else {
 -                        tcg_gen_movi_i32(tmp, imm);
 -                    }
 +                    tcg_gen_gvec_ori(MO_32, reg_ofs, reg_ofs, imm,
 +                                     vec_size, vec_size);
 +                }
 +            } else {
 +                /* VMOV, VMVN.  */
 +                if (op == 14 && invert) {
 +                    TCGv_i64 t64 = tcg_temp_new_i64();
 +
 +                    for (pass = 0; pass <= q; ++pass) {
 +                        uint64_t val = 0;
 +                        int n;
 +
 +                        for (n = 0; n < 8; n++) {
 +                            if (imm & (1 << (n + pass * 8))) {
 +                                val |= 0xffull << (n * 8);
 +                            }
 +                        }
 +                        tcg_gen_movi_i64(t64, val);
 +                        neon_store_reg64(t64, rd + pass);
 +                    }
 +                    tcg_temp_free_i64(t64);
 +                } else {
 +                    tcg_gen_gvec_dup32i(reg_ofs, vec_size, vec_size, imm);
                  }
 -                neon_store_reg(rd, pass, tmp);
              }
          }
      } else { /* (insn & 0x00800010 == 0x00800000) */
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 26/45] target/arm: Mark some arrays const
+[PULL 091/117] target/arm: Use TRANS_FEAT for FTMAD
 From: Richard Henderson <richard.henderson@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
+Message-id: 20220527181907.189259-89-richard.henderson@linaro.org
 Message-id: 20181011205206.3552-6-richard.henderson@linaro.org
 [PMM: drop change to now-deleted cpu_mode_names array]
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.c | 4 ++--
+ target/arm/translate-sve.c | 29 +++++++----------------------
-file changed, 2 insertions(+), 2 deletions(-)
+file changed, 7 insertions(+), 22 deletions(-)
-diff --git a/target/arm/translate.c b/target/arm/translate.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static TCGv_i64 cpu_F0d, cpu_F1d;
+@@ -XXX,XX +XXX,XX @@ DO_PPZ(FCMNE_ppz0, fcmne0)
+  *** SVE floating-point trig multiply-add coefficient
- #include "exec/gen-icount.h"
+  */
--static const char *regnames[] =
+-static bool trans_FTMAD(DisasContext *s, arg_FTMAD *a)
-+static const char * const regnames[] =
+-{
-     { "r0", "r1", "r2", "r3", "r4", "r5", "r6", "r7",
+-    static gen_helper_gvec_3_ptr * const fns[3] = {
-       "r8", "r9", "r10", "r11", "r12", "r13", "r14", "pc" };
+-        gen_helper_sve_ftmad_h,
+-        gen_helper_sve_ftmad_s,
-@@ -XXX,XX +XXX,XX @@ static struct {
+-        gen_helper_sve_ftmad_d,
-     int nregs;
+-    };
-     int interleave;
+-
-     int spacing;
+-    if (a->esz == 0) {
--} neon_ls_element_type[11] = {
+-        return false;
-+} const neon_ls_element_type[11] = {
+-    }
-     {4, 4, 1},
+-    if (sve_access_check(s)) {
-     {4, 4, 2},
+-        unsigned vsz = vec_full_reg_size(s);
-     {4, 1, 1},
+-        TCGv_ptr status = fpstatus_ptr(a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
 -        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, a->rd),
 -                           vec_full_reg_offset(s, a->rn),
 -                           vec_full_reg_offset(s, a->rm),
 -                           status, vsz, vsz, a->imm, fns[a->esz - 1]);
 -        tcg_temp_free_ptr(status);
 -    }
 -    return true;
 -}
 +static gen_helper_gvec_3_ptr * const ftmad_fns[4] = {
 +    NULL,                   gen_helper_sve_ftmad_h,
 +    gen_helper_sve_ftmad_s, gen_helper_sve_ftmad_d,
 +};
 +TRANS_FEAT(FTMAD, aa64_sve, gen_gvec_fpst_zzz,
 +           ftmad_fns[a->esz], a->rd, a->rn, a->rm, a->imm,
 +           a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR)
  /*
   *** SVE Floating Point Accumulating Reduction Group
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 23/45] target/arm: Don't call tcg_clear_temp_count
+[PULL 092/117] target/arm: Move null function and sve check into do_reduce
 From: Richard Henderson <richard.henderson@linaro.org>
-This is done generically in translator_loop.
-Reported-by: Laurent Desnogues <laurent.desnogues@gmail.com>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
+Message-id: 20220527181907.189259-90-richard.henderson@linaro.org
 Message-id: 20181011205206.3552-3-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate-a64.c | 1 -
+ target/arm/translate-sve.c | 30 +++++++++++++++++-------------
- target/arm/translate.c     | 1 -
+file changed, 17 insertions(+), 13 deletions(-)
 files changed, 2 deletions(-)
-diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-a64.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate-a64.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_init_disas_context(DisasContextBase *dcbase,
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(FMUL_zzx, aa64_sve, gen_gvec_fpst_zzz,
+ typedef void gen_helper_fp_reduce(TCGv_i64, TCGv_ptr, TCGv_ptr,
- static void aarch64_tr_tb_start(DisasContextBase *db, CPUState *cpu)
+                                   TCGv_ptr, TCGv_i32);
 -static void do_reduce(DisasContext *s, arg_rpr_esz *a,
 +static bool do_reduce(DisasContext *s, arg_rpr_esz *a,
                        gen_helper_fp_reduce *fn)
  {
--    tcg_clear_temp_count();
+-    unsigned vsz = vec_full_reg_size(s);
 -    unsigned p2vsz = pow2ceil(vsz);
 -    TCGv_i32 t_desc = tcg_constant_i32(simd_desc(vsz, vsz, p2vsz));
 +    unsigned vsz, p2vsz;
 +    TCGv_i32 t_desc;
      TCGv_ptr t_zn, t_pg, status;
      TCGv_i64 temp;
 +    if (fn == NULL) {
 +        return false;
 +    }
 +    if (!sve_access_check(s)) {
 +        return true;
 +    }
 +
 +    vsz = vec_full_reg_size(s);
 +    p2vsz = pow2ceil(vsz);
 +    t_desc = tcg_constant_i32(simd_desc(vsz, vsz, p2vsz));
      temp = tcg_temp_new_i64();
      t_zn = tcg_temp_new_ptr();
      t_pg = tcg_temp_new_ptr();
@@ -XXX,XX +XXX,XX @@ static void do_reduce(DisasContext *s, arg_rpr_esz *a,
      write_fp_dreg(s, a->rd, temp);
      tcg_temp_free_i64(temp);
 +    return true;
  }
- static void aarch64_tr_insn_start(DisasContextBase *dcbase, CPUState *cpu)
+ #define DO_VPZ(NAME, name) \
-diff --git a/target/arm/translate.c b/target/arm/translate.c
+ static bool trans_##NAME(DisasContext *s, arg_rpr_esz *a)                \
-index XXXXXXX..XXXXXXX 100644
+ {                                                                        \
---- a/target/arm/translate.c
+-    static gen_helper_fp_reduce * const fns[3] = {                       \
-+++ b/target/arm/translate.c
+-        gen_helper_sve_##name##_h,                                       \
-@@ -XXX,XX +XXX,XX @@ static void arm_tr_tb_start(DisasContextBase *dcbase, CPUState *cpu)
++    static gen_helper_fp_reduce * const fns[4] = {                       \
-         tcg_gen_movi_i32(tmp, 0);
++        NULL, gen_helper_sve_##name##_h,                                 \
-         store_cpu_field(tmp, condexec_bits);
+         gen_helper_sve_##name##_s,                                       \
-     }
+         gen_helper_sve_##name##_d,                                       \
--    tcg_clear_temp_count();
+     };                                                                   \
 -    if (a->esz == 0) {                                                   \
 -        return false;                                                    \
 -    }                                                                    \
 -    if (sve_access_check(s)) {                                           \
 -        do_reduce(s, a, fns[a->esz - 1]);                                \
 -    }                                                                    \
 -    return true;                                                         \
 +    return do_reduce(s, a, fns[a->esz]);                                 \
  }
- static void arm_tr_insn_start(DisasContextBase *dcbase, CPUState *cpu)
+ DO_VPZ(FADDV, faddv)
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 01/45] ssi-sd: Make devices picking up backends unavailable with -device
+[PULL 093/117] target/arm: Use TRANS_FEAT for do_reduce
-From: Markus Armbruster <armbru@redhat.com>
+From: Richard Henderson <richard.henderson@linaro.org>
-Device models aren't supposed to go on fishing expeditions for
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-backends.  They should expose suitable properties for the user to set.
+Message-id: 20220527181907.189259-91-richard.henderson@linaro.org
-For onboard devices, board code sets them.
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Device ssi-sd picks up its block backend in its init() method with
 drive_get_next() instead.  This mistake is already marked FIXME since
 commit af9e40a.
 Unset user_creatable to remove the mistake from our external
 interface.  Since the SSI bus doesn't support hotplug, only -device
 can be affected.  Only certain ARM machines have ssi-sd and provide an
 SSI bus for it; this patch breaks -device ssi-sd for these machines.
 No actual use of -device ssi-sd is known.
 Signed-off-by: Markus Armbruster <armbru@redhat.com>
 Acked-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
 Acked-by: Thomas Huth <thuth@redhat.com>
 Message-id: 20181009060835.4608-1-armbru@redhat.com
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- hw/sd/ssi-sd.c | 2 ++
+ target/arm/translate-sve.c | 14 ++++++--------
-file changed, 2 insertions(+)
+file changed, 6 insertions(+), 8 deletions(-)
-diff --git a/hw/sd/ssi-sd.c b/hw/sd/ssi-sd.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/hw/sd/ssi-sd.c
+--- a/target/arm/translate-sve.c
-+++ b/hw/sd/ssi-sd.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static void ssi_sd_class_init(ObjectClass *klass, void *data)
+@@ -XXX,XX +XXX,XX @@ static bool do_reduce(DisasContext *s, arg_rpr_esz *a,
      k->cs_polarity = SSI_CS_LOW;
      dc->vmsd = &vmstate_ssi_sd;
      dc->reset = ssi_sd_reset;
 +    /* Reason: init() method uses drive_get_next() */
 +    dc->user_creatable = false;
  }
- static const TypeInfo ssi_sd_info = {
+ #define DO_VPZ(NAME, name) \
 -static bool trans_##NAME(DisasContext *s, arg_rpr_esz *a)                \
 -{                                                                        \
 -    static gen_helper_fp_reduce * const fns[4] = {                       \
 -        NULL, gen_helper_sve_##name##_h,                                 \
 -        gen_helper_sve_##name##_s,                                       \
 -        gen_helper_sve_##name##_d,                                       \
 +    static gen_helper_fp_reduce * const name##_fns[4] = {                \
 +        NULL,                      gen_helper_sve_##name##_h,            \
 +        gen_helper_sve_##name##_s, gen_helper_sve_##name##_d,            \
      };                                                                   \
 -    return do_reduce(s, a, fns[a->esz]);                                 \
 -}
 +    TRANS_FEAT(NAME, aa64_sve, do_reduce, a, name##_fns[a->esz])
  DO_VPZ(FADDV, faddv)
  DO_VPZ(FMINNMV, fminnmv)
@@ -XXX,XX +XXX,XX @@ DO_VPZ(FMAXNMV, fmaxnmv)
  DO_VPZ(FMINV, fminv)
  DO_VPZ(FMAXV, fmaxv)
 +#undef DO_VPZ
 +
  /*
   *** SVE Floating Point Unary Operations - Unpredicated Group
   */
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 10/45] target/arm: Convert v8.2-fp16 from feature bit to aa64pfr0 test
+[PULL 094/117] target/arm: Use TRANS_FEAT for FRECPE, FRSQRTE
 From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
+Rename do_zz_fp to gen_gvec_fpst_arg_zz, and move up.
 Split out gen_gvec_fpst_zz as a helper while we're at it.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181016223115.24100-9-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-92-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.h           | 17 +++++++++++++++-
+ target/arm/translate-sve.c | 77 ++++++++++++++++++--------------------
- linux-user/elfload.c       |  6 +-----
+file changed, 36 insertions(+), 41 deletions(-)
  target/arm/cpu64.c         | 16 ++++++++-------
  target/arm/helper.c        |  2 +-
  target/arm/translate-a64.c | 40 +++++++++++++++++++-------------------
  target/arm/translate.c     |  6 +++---
 files changed, 50 insertions(+), 37 deletions(-)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/cpu.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ enum arm_features {
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_zz(DisasContext *s, gen_helper_gvec_2 *fn,
-     ARM_FEATURE_PMU, /* has PMU support */
+     return true;
      ARM_FEATURE_VBAR, /* has cp15 VBAR */
      ARM_FEATURE_M_SECURITY, /* M profile Security Extension */
 -    ARM_FEATURE_V8_FP16, /* implements v8.2 half-precision float */
      ARM_FEATURE_M_MAIN, /* M profile Main Extension */
  };
@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_aa32_dp(const ARMISARegisters *id)
      return FIELD_EX32(id->id_isar6, ID_ISAR6, DP) != 0;
  }
-+static inline bool isar_feature_aa32_fp16_arith(const ARMISARegisters *id)
++static bool gen_gvec_fpst_zz(DisasContext *s, gen_helper_gvec_2_ptr *fn,
 +                             int rd, int rn, int data,
 +                             ARMFPStatusFlavour flavour)
 +{
-+    /*
++    if (fn == NULL) {
-+     * This is a placeholder for use by VCMA until the rest of
++        return false;
-+     * the ARMv8.2-FP16 extension is implemented for aa32 mode.
++    }
-+     * At which point we can properly set and check MVFR1.FPHP.
++    if (sve_access_check(s)) {
-+     */
++        unsigned vsz = vec_full_reg_size(s);
-+    return FIELD_EX64(id->id_aa64pfr0, ID_AA64PFR0, FP) == 1;
++        TCGv_ptr status = fpstatus_ptr(flavour);
 +
 +        tcg_gen_gvec_2_ptr(vec_full_reg_offset(s, rd),
 +                           vec_full_reg_offset(s, rn),
 +                           status, vsz, vsz, data, fn);
 +        tcg_temp_free_ptr(status);
 +    }
 +    return true;
 +}
 +
- /*
++static bool gen_gvec_fpst_arg_zz(DisasContext *s, gen_helper_gvec_2_ptr *fn,
-  * 64-bit feature tests via id registers.
++                                 arg_rr_esz *a, int data)
   */
@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_aa64_fcma(const ARMISARegisters *id)
      return FIELD_EX64(id->id_aa64isar1, ID_AA64ISAR1, FCMA) != 0;
  }
 +static inline bool isar_feature_aa64_fp16(const ARMISARegisters *id)
 +{
-+    /* We always set the AdvSIMD and FP fields identically wrt FP16.  */
++    return gen_gvec_fpst_zz(s, fn, a->rd, a->rn, data,
-+    return FIELD_EX64(id->id_aa64pfr0, ID_AA64PFR0, FP) == 1;
++                            a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
 +}
 +
- static inline bool isar_feature_aa64_sve(const ARMISARegisters *id)
+ /* Invoke an out-of-line helper on 3 Zregs. */
- {
+ static bool gen_gvec_ool_zzz(DisasContext *s, gen_helper_gvec_3 *fn,
-     return FIELD_EX64(id->id_aa64pfr0, ID_AA64PFR0, SVE) != 0;
+                              int rd, int rn, int rm, int data)
-diff --git a/linux-user/elfload.c b/linux-user/elfload.c
+@@ -XXX,XX +XXX,XX @@ DO_VPZ(FMAXV, fmaxv)
-index XXXXXXX..XXXXXXX 100644
+  *** SVE Floating Point Unary Operations - Unpredicated Group
---- a/linux-user/elfload.c
+  */
-+++ b/linux-user/elfload.c
-@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
+-static void do_zz_fp(DisasContext *s, arg_rr_esz *a, gen_helper_gvec_2_ptr *fn)
-     hwcaps |= ARM_HWCAP_A64_ASIMD;
+-{
+-    unsigned vsz = vec_full_reg_size(s);
-     /* probe for the extra features */
+-    TCGv_ptr status = fpstatus_ptr(a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
--#define GET_FEATURE(feat, hwcap) \
++static gen_helper_gvec_2_ptr * const frecpe_fns[] = {
--    do { if (arm_feature(&cpu->env, feat)) { hwcaps |= hwcap; } } while (0)
++    NULL,                     gen_helper_gvec_frecpe_h,
- #define GET_FEATURE_ID(feat, hwcap) \
++    gen_helper_gvec_frecpe_s, gen_helper_gvec_frecpe_d,
-     do { if (cpu_isar_feature(feat, cpu)) { hwcaps |= hwcap; } } while (0)
++};
++TRANS_FEAT(FRECPE, aa64_sve, gen_gvec_fpst_arg_zz, frecpe_fns[a->esz], a, 0)
-@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
-     GET_FEATURE_ID(aa64_sha3, ARM_HWCAP_A64_SHA3);
+-    tcg_gen_gvec_2_ptr(vec_full_reg_offset(s, a->rd),
-     GET_FEATURE_ID(aa64_sm3, ARM_HWCAP_A64_SM3);
+-                       vec_full_reg_offset(s, a->rn),
-     GET_FEATURE_ID(aa64_sm4, ARM_HWCAP_A64_SM4);
+-                       status, vsz, vsz, 0, fn);
--    GET_FEATURE(ARM_FEATURE_V8_FP16,
+-    tcg_temp_free_ptr(status);
--                ARM_HWCAP_A64_FPHP | ARM_HWCAP_A64_ASIMDHP);
+-}
-+    GET_FEATURE_ID(aa64_fp16, ARM_HWCAP_A64_FPHP | ARM_HWCAP_A64_ASIMDHP);
+-
-     GET_FEATURE_ID(aa64_atomics, ARM_HWCAP_A64_ATOMICS);
+-static bool trans_FRECPE(DisasContext *s, arg_rr_esz *a)
-     GET_FEATURE_ID(aa64_rdm, ARM_HWCAP_A64_ASIMDRDM);
+-{
-     GET_FEATURE_ID(aa64_dp, ARM_HWCAP_A64_ASIMDDP);
+-    static gen_helper_gvec_2_ptr * const fns[3] = {
-     GET_FEATURE_ID(aa64_fcma, ARM_HWCAP_A64_FCMA);
+-        gen_helper_gvec_frecpe_h,
-     GET_FEATURE_ID(aa64_sve, ARM_HWCAP_A64_SVE);
+-        gen_helper_gvec_frecpe_s,
+-        gen_helper_gvec_frecpe_d,
--#undef GET_FEATURE
+-    };
- #undef GET_FEATURE_ID
+-    if (a->esz == 0) {
+-        return false;
-     return hwcaps;
+-    }
-diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
+-    if (sve_access_check(s)) {
-index XXXXXXX..XXXXXXX 100644
+-        do_zz_fp(s, a, fns[a->esz - 1]);
---- a/target/arm/cpu64.c
+-    }
-+++ b/target/arm/cpu64.c
+-    return true;
-@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
+-}
+-
-         t = cpu->isar.id_aa64pfr0;
+-static bool trans_FRSQRTE(DisasContext *s, arg_rr_esz *a)
-         t = FIELD_DP64(t, ID_AA64PFR0, SVE, 1);
+-{
-+        t = FIELD_DP64(t, ID_AA64PFR0, FP, 1);
+-    static gen_helper_gvec_2_ptr * const fns[3] = {
-+        t = FIELD_DP64(t, ID_AA64PFR0, ADVSIMD, 1);
+-        gen_helper_gvec_frsqrte_h,
-         cpu->isar.id_aa64pfr0 = t;
+-        gen_helper_gvec_frsqrte_s,
+-        gen_helper_gvec_frsqrte_d,
-         /* Replicate the same data to the 32-bit id registers.  */
+-    };
-@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
+-    if (a->esz == 0) {
-         u = FIELD_DP32(u, ID_ISAR6, DP, 1);
+-        return false;
-         cpu->isar.id_isar6 = u;
+-    }
+-    if (sve_access_check(s)) {
--#ifdef CONFIG_USER_ONLY
+-        do_zz_fp(s, a, fns[a->esz - 1]);
--        /* We don't set these in system emulation mode for the moment,
+-    }
--         * since we don't correctly set the ID registers to advertise them,
+-    return true;
--         * and in some cases they're only available in AArch64 and not AArch32,
+-}
--         * whereas the architecture requires them to be present in both if
++static gen_helper_gvec_2_ptr * const frsqrte_fns[] = {
--         * present in either.
++    NULL,                      gen_helper_gvec_frsqrte_h,
-+        /*
++    gen_helper_gvec_frsqrte_s, gen_helper_gvec_frsqrte_d,
-+         * FIXME: We do not yet support ARMv8.2-fp16 for AArch32 yet,
++};
-+         * so do not set MVFR1.FPHP.  Strictly speaking this is not legal,
++TRANS_FEAT(FRSQRTE, aa64_sve, gen_gvec_fpst_arg_zz, frsqrte_fns[a->esz], a, 0)
-+         * but it is also not legal to enable SVE without support for FP16,
-+         * and enabling SVE in system mode is more useful in the short term.
+ /*
-          */
+  *** SVE Floating Point Compare with Zero Group
 -        set_feature(&cpu->env, ARM_FEATURE_V8_FP16);
 +
 +#ifdef CONFIG_USER_ONLY
          /* For usermode -cpu max we can use a larger and more efficient DCZ
           * blocksize since we don't have to follow what the hardware does.
           */
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(vfp_set_fpscr)(CPUARMState *env, uint32_t val)
      uint32_t changed;
      /* When ARMv8.2-FP16 is not supported, FZ16 is RES0.  */
 -    if (!arm_feature(env, ARM_FEATURE_V8_FP16)) {
 +    if (!cpu_isar_feature(aa64_fp16, arm_env_get_cpu(env))) {
          val &= ~FPCR_FZ16;
      }
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_fp_compare(DisasContext *s, uint32_t insn)
          break;
      case 3:
          size = MO_16;
 -        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (dc_isar_feature(aa64_fp16, s)) {
              break;
          }
          /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_ccomp(DisasContext *s, uint32_t insn)
          break;
      case 3:
          size = MO_16;
 -        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (dc_isar_feature(aa64_fp16, s)) {
              break;
          }
          /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_csel(DisasContext *s, uint32_t insn)
          break;
      case 3:
          sz = MO_16;
 -        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (dc_isar_feature(aa64_fp16, s)) {
              break;
          }
          /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_1src(DisasContext *s, uint32_t insn)
              handle_fp_1src_double(s, opcode, rd, rn);
              break;
          case 3:
 -            if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +            if (!dc_isar_feature(aa64_fp16, s)) {
                  unallocated_encoding(s);
                  return;
              }
@@ -XXX,XX +XXX,XX @@ static void disas_fp_2src(DisasContext *s, uint32_t insn)
          handle_fp_2src_double(s, opcode, rd, rn, rm);
          break;
      case 3:
 -        if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (!dc_isar_feature(aa64_fp16, s)) {
              unallocated_encoding(s);
              return;
          }
@@ -XXX,XX +XXX,XX @@ static void disas_fp_3src(DisasContext *s, uint32_t insn)
          handle_fp_3src_double(s, o0, o1, rd, rn, rm, ra);
          break;
      case 3:
 -        if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (!dc_isar_feature(aa64_fp16, s)) {
              unallocated_encoding(s);
              return;
          }
@@ -XXX,XX +XXX,XX @@ static void disas_fp_imm(DisasContext *s, uint32_t insn)
          break;
      case 3:
          sz = MO_16;
 -        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (dc_isar_feature(aa64_fp16, s)) {
              break;
          }
          /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_fixed_conv(DisasContext *s, uint32_t insn)
      case 1: /* float64 */
          break;
      case 3: /* float16 */
 -        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (dc_isar_feature(aa64_fp16, s)) {
              break;
          }
          /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_int_conv(DisasContext *s, uint32_t insn)
              break;
          case 0x6: /* 16-bit float, 32-bit int */
          case 0xe: /* 16-bit float, 64-bit int */
 -            if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +            if (dc_isar_feature(aa64_fp16, s)) {
                  break;
              }
              /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_int_conv(DisasContext *s, uint32_t insn)
          case 1: /* float64 */
              break;
          case 3: /* float16 */
 -            if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +            if (dc_isar_feature(aa64_fp16, s)) {
                  break;
              }
              /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_across_lanes(DisasContext *s, uint32_t insn)
           */
          is_min = extract32(size, 1, 1);
          is_fp = true;
 -        if (!is_u && arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (!is_u && dc_isar_feature(aa64_fp16, s)) {
              size = 1;
          } else if (!is_u || !is_q || extract32(size, 0, 1)) {
              unallocated_encoding(s);
@@ -XXX,XX +XXX,XX @@ static void disas_simd_mod_imm(DisasContext *s, uint32_t insn)
      if (o2 != 0 || ((cmode == 0xf) && is_neg && !is_q)) {
          /* Check for FMOV (vector, immediate) - half-precision */
 -        if (!(arm_dc_feature(s, ARM_FEATURE_V8_FP16) && o2 && cmode == 0xf)) {
 +        if (!(dc_isar_feature(aa64_fp16, s) && o2 && cmode == 0xf)) {
              unallocated_encoding(s);
              return;
          }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_pairwise(DisasContext *s, uint32_t insn)
      case 0x2f: /* FMINP */
          /* FP op, size[0] is 32 or 64 bit*/
          if (!u) {
 -            if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +            if (!dc_isar_feature(aa64_fp16, s)) {
                  unallocated_encoding(s);
                  return;
              } else {
@@ -XXX,XX +XXX,XX @@ static void handle_simd_shift_intfp_conv(DisasContext *s, bool is_scalar,
          size = MO_32;
      } else if (immh & 2) {
          size = MO_16;
 -        if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (!dc_isar_feature(aa64_fp16, s)) {
              unallocated_encoding(s);
              return;
          }
@@ -XXX,XX +XXX,XX @@ static void handle_simd_shift_fpint_conv(DisasContext *s, bool is_scalar,
          size = MO_32;
      } else if (immh & 0x2) {
          size = MO_16;
 -        if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +        if (!dc_isar_feature(aa64_fp16, s)) {
              unallocated_encoding(s);
              return;
          }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_three_reg_same_fp16(DisasContext *s,
          return;
      }
 -    if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +    if (!dc_isar_feature(aa64_fp16, s)) {
          unallocated_encoding(s);
      }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_fp16(DisasContext *s, uint32_t insn)
      TCGv_ptr fpst;
      bool pairwise = false;
 -    if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +    if (!dc_isar_feature(aa64_fp16, s)) {
          unallocated_encoding(s);
          return;
      }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
      case 0x1c: /* FCADD, #90 */
      case 0x1e: /* FCADD, #270 */
          if (size == 0
 -            || (size == 1 && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))
 +            || (size == 1 && !dc_isar_feature(aa64_fp16, s))
              || (size == 3 && !is_q)) {
              unallocated_encoding(s);
              return;
@@ -XXX,XX +XXX,XX @@ static void disas_simd_two_reg_misc_fp16(DisasContext *s, uint32_t insn)
      bool need_fpst = true;
      int rmode;
 -    if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +    if (!dc_isar_feature(aa64_fp16, s)) {
          unallocated_encoding(s);
          return;
      }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
          }
          break;
      }
 -    if (is_fp16 && !arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +    if (is_fp16 && !dc_isar_feature(aa64_fp16, s)) {
          unallocated_encoding(s);
          return;
      }
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
          int size = extract32(insn, 20, 1);
          data = extract32(insn, 23, 2); /* rot */
          if (!dc_isar_feature(aa32_vcma, s)
 -            || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
 +            || (!size && !dc_isar_feature(aa32_fp16_arith, s))) {
              return 1;
          }
          fn_gvec_ptr = size ? gen_helper_gvec_fcmlas : gen_helper_gvec_fcmlah;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
          int size = extract32(insn, 20, 1);
          data = extract32(insn, 24, 1); /* rot */
          if (!dc_isar_feature(aa32_vcma, s)
 -            || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
 +            || (!size && !dc_isar_feature(aa32_fp16_arith, s))) {
              return 1;
          }
          fn_gvec_ptr = size ? gen_helper_gvec_fcadds : gen_helper_gvec_fcaddh;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
              return 1;
          }
          if (size == 0) {
 -            if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +            if (!dc_isar_feature(aa32_fp16_arith, s)) {
                  return 1;
              }
              /* For fp16, rm is just Vm, and index is M.  */
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 22/45] target/arm: Hoist address increment for vector memory ops
+[PULL 095/117] target/arm: Expand frint_fns for MO_8
-From: Richard Henderson <rth@twiddle.net>
+From: Richard Henderson <richard.henderson@linaro.org>
-This can reduce the number of opcodes required for certain
+Simplify indexing of this array.  This will allow folding
-complex forms of load-multiple (e.g. ld4.16b).
+of the illegal esz == 0 into the normal fn == NULL check.
-Signed-off-by: Richard Henderson <rth@twiddle.net>
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-2-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-93-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate-a64.c | 12 ++++++++----
+ target/arm/translate-sve.c | 15 ++++++++-------
-file changed, 8 insertions(+), 4 deletions(-)
+file changed, 8 insertions(+), 7 deletions(-)
-diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-a64.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate-a64.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static bool trans_FCVTZU_dd(DisasContext *s, arg_rpr_esz *a)
-     bool is_store = !extract32(insn, 22, 1);
+     return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzu_dd);
-     bool is_postidx = extract32(insn, 23, 1);
+ }
-     bool is_q = extract32(insn, 30, 1);
--    TCGv_i64 tcg_addr, tcg_rn;
+-static gen_helper_gvec_3_ptr * const frint_fns[3] = {
-+    TCGv_i64 tcg_addr, tcg_rn, tcg_ebytes;
++static gen_helper_gvec_3_ptr * const frint_fns[] = {
++    NULL,
-     int ebytes = 1 << size;
+     gen_helper_sve_frint_h,
-     int elements = (is_q ? 128 : 64) / (8 << size);
+     gen_helper_sve_frint_s,
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
+     gen_helper_sve_frint_d
-     tcg_rn = cpu_reg_sp(s, rn);
+@@ -XXX,XX +XXX,XX @@ static bool trans_FRINTI(DisasContext *s, arg_rpr_esz *a)
-     tcg_addr = tcg_temp_new_i64();
+         return false;
      tcg_gen_mov_i64(tcg_addr, tcg_rn);
 +    tcg_ebytes = tcg_const_i64(ebytes);
      for (r = 0; r < rpt; r++) {
          int e;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
                          clear_vec_high(s, is_q, tt);
                      }
                  }
 -                tcg_gen_addi_i64(tcg_addr, tcg_addr, ebytes);
 +                tcg_gen_add_i64(tcg_addr, tcg_addr, tcg_ebytes);
                  tt = (tt + 1) % 32;
              }
          }
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
              tcg_gen_add_i64(tcg_rn, tcg_rn, cpu_reg(s, rm));
          }
      }
-+    tcg_temp_free_i64(tcg_ebytes);
+     return do_zpz_ptr(s, a->rd, a->rn, a->pg, a->esz == MO_16,
-     tcg_temp_free_i64(tcg_addr);
+-                      frint_fns[a->esz - 1]);
 +                      frint_fns[a->esz]);
  }
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
+ static bool trans_FRINTX(DisasContext *s, arg_rpr_esz *a)
-     bool replicate = false;
+@@ -XXX,XX +XXX,XX @@ static bool trans_FRINTN(DisasContext *s, arg_rpr_esz *a)
-     int index = is_q << 3 | S << 2 | size;
+     if (a->esz == 0) {
-     int ebytes, xs;
+         return false;
 -    TCGv_i64 tcg_addr, tcg_rn;
 +    TCGv_i64 tcg_addr, tcg_rn, tcg_ebytes;
      switch (scale) {
      case 3:
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
      tcg_rn = cpu_reg_sp(s, rn);
      tcg_addr = tcg_temp_new_i64();
      tcg_gen_mov_i64(tcg_addr, tcg_rn);
 +    tcg_ebytes = tcg_const_i64(ebytes);
      for (xs = 0; xs < selem; xs++) {
          if (replicate) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
                  do_vec_st(s, rt, index, tcg_addr, scale);
              }
          }
 -        tcg_gen_addi_i64(tcg_addr, tcg_addr, ebytes);
 +        tcg_gen_add_i64(tcg_addr, tcg_addr, tcg_ebytes);
          rt = (rt + 1) % 32;
      }
+-    return do_frint_mode(s, a, float_round_nearest_even, frint_fns[a->esz - 1]);
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
++    return do_frint_mode(s, a, float_round_nearest_even, frint_fns[a->esz]);
-             tcg_gen_add_i64(tcg_rn, tcg_rn, cpu_reg(s, rm));
+ }
-         }
  static bool trans_FRINTP(DisasContext *s, arg_rpr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_FRINTP(DisasContext *s, arg_rpr_esz *a)
      if (a->esz == 0) {
          return false;
      }
-+    tcg_temp_free_i64(tcg_ebytes);
+-    return do_frint_mode(s, a, float_round_up, frint_fns[a->esz - 1]);
-     tcg_temp_free_i64(tcg_addr);
++    return do_frint_mode(s, a, float_round_up, frint_fns[a->esz]);
  }
+ static bool trans_FRINTM(DisasContext *s, arg_rpr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_FRINTM(DisasContext *s, arg_rpr_esz *a)
+     if (a->esz == 0) {
+         return false;
+     }
+-    return do_frint_mode(s, a, float_round_down, frint_fns[a->esz - 1]);
++    return do_frint_mode(s, a, float_round_down, frint_fns[a->esz]);
+ }
+ static bool trans_FRINTZ(DisasContext *s, arg_rpr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_FRINTZ(DisasContext *s, arg_rpr_esz *a)
+     if (a->esz == 0) {
+         return false;
+     }
+-    return do_frint_mode(s, a, float_round_to_zero, frint_fns[a->esz - 1]);
++    return do_frint_mode(s, a, float_round_to_zero, frint_fns[a->esz]);
+ }
+ static bool trans_FRINTA(DisasContext *s, arg_rpr_esz *a)
+@@ -XXX,XX +XXX,XX @@ static bool trans_FRINTA(DisasContext *s, arg_rpr_esz *a)
+     if (a->esz == 0) {
+         return false;
+     }
+-    return do_frint_mode(s, a, float_round_ties_away, frint_fns[a->esz - 1]);
++    return do_frint_mode(s, a, float_round_ties_away, frint_fns[a->esz]);
+ }
+ static bool trans_FRECPX(DisasContext *s, arg_rpr_esz *a)
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 06/45] target/arm: Convert division from feature bits to isar0 tests
+[PULL 096/117] target/arm: Rename do_zpz_ptr to gen_gvec_ool_fpst_arg_zpz
 From: Richard Henderson <richard.henderson@linaro.org>
-Both arm and thumb2 division are controlled by the same ISAR field,
+Rename the function to match other expansion function and
-which takes care of the arm implies thumb case.  Having M imply
+move to be adjacent.  Split out gen_gvec_fpst_zzp as a
-thumb2 division was wrong for cortex-m0, which is v6m and does not
+helper while we're at it.
 have thumb2 at all, much less thumb2 division.
-Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181016223115.24100-5-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-94-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.h       | 12 ++++++++++--
+ target/arm/translate-sve.c | 392 ++++++++++++-------------------------
- linux-user/elfload.c   |  4 ++--
+file changed, 129 insertions(+), 263 deletions(-)
  target/arm/cpu.c       | 10 +---------
  target/arm/translate.c |  4 ++--
 files changed, 15 insertions(+), 15 deletions(-)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/cpu.h
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ enum arm_features {
+@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_arg_zpzi(DisasContext *s, gen_helper_gvec_3 *fn,
-     ARM_FEATURE_VFP3,
+     return gen_gvec_ool_zzp(s, fn, a->rd, a->rn, a->pg, a->imm);
-     ARM_FEATURE_VFP_FP16,
+ }
-     ARM_FEATURE_NEON,
--    ARM_FEATURE_THUMB_DIV, /* divide supported in Thumb encoding */
++static bool gen_gvec_fpst_zzp(DisasContext *s, gen_helper_gvec_3_ptr *fn,
-     ARM_FEATURE_M, /* Microcontroller profile.  */
++                              int rd, int rn, int pg, int data,
-     ARM_FEATURE_OMAPCP, /* OMAP specific CP15 ops handling.  */
++                              ARMFPStatusFlavour flavour)
      ARM_FEATURE_THUMB2EE,
@@ -XXX,XX +XXX,XX @@ enum arm_features {
      ARM_FEATURE_V5,
      ARM_FEATURE_STRONGARM,
      ARM_FEATURE_VAPA, /* cp15 VA to PA lookups */
 -    ARM_FEATURE_ARM_DIV, /* divide supported in ARM encoding */
      ARM_FEATURE_VFP4, /* VFPv4 (implies that NEON is v2) */
      ARM_FEATURE_GENERIC_TIMER,
      ARM_FEATURE_MVFR, /* Media and VFP Feature Registers 0 and 1 */
@@ -XXX,XX +XXX,XX @@ extern const uint64_t pred_esz_masks[4];
  /*
   * 32-bit feature tests via id registers.
   */
 +static inline bool isar_feature_thumb_div(const ARMISARegisters *id)
 +{
-+    return FIELD_EX32(id->id_isar0, ID_ISAR0, DIVIDE) != 0;
++    if (fn == NULL) {
 +        return false;
 +    }
 +    if (sve_access_check(s)) {
 +        unsigned vsz = vec_full_reg_size(s);
 +        TCGv_ptr status = fpstatus_ptr(flavour);
 +
 +        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, rd),
 +                           vec_full_reg_offset(s, rn),
 +                           pred_full_reg_offset(s, pg),
 +                           status, vsz, vsz, data, fn);
 +        tcg_temp_free_ptr(status);
 +    }
 +    return true;
 +}
 +
-+static inline bool isar_feature_arm_div(const ARMISARegisters *id)
++static bool gen_gvec_fpst_arg_zpz(DisasContext *s, gen_helper_gvec_3_ptr *fn,
 +                                  arg_rpr_esz *a, int data,
 +                                  ARMFPStatusFlavour flavour)
 +{
-+    return FIELD_EX32(id->id_isar0, ID_ISAR0, DIVIDE) > 1;
++    return gen_gvec_fpst_zzp(s, fn, a->rd, a->rn, a->pg, data, flavour);
 +}
 +
- static inline bool isar_feature_aa32_aes(const ARMISARegisters *id)
+ /* Invoke an out-of-line helper on 3 Zregs and a predicate. */
  static bool gen_gvec_ool_zzzp(DisasContext *s, gen_helper_gvec_4 *fn,
                                int rd, int rn, int rm, int pg, int data)
@@ -XXX,XX +XXX,XX @@ static bool trans_FCMLA_zzxz(DisasContext *s, arg_FCMLA_zzxz *a)
   *** SVE Floating Point Unary Operations Predicated Group
   */
 -static bool do_zpz_ptr(DisasContext *s, int rd, int rn, int pg,
 -                       bool is_fp16, gen_helper_gvec_3_ptr *fn)
 -{
 -    if (sve_access_check(s)) {
 -        unsigned vsz = vec_full_reg_size(s);
 -        TCGv_ptr status = fpstatus_ptr(is_fp16 ? FPST_FPCR_F16 : FPST_FPCR);
 -        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, rd),
 -                           vec_full_reg_offset(s, rn),
 -                           pred_full_reg_offset(s, pg),
 -                           status, vsz, vsz, 0, fn);
 -        tcg_temp_free_ptr(status);
 -    }
 -    return true;
 -}
 +TRANS_FEAT(FCVT_sh, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvt_sh, a, 0, FPST_FPCR)
 +TRANS_FEAT(FCVT_hs, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvt_hs, a, 0, FPST_FPCR)
 -static bool trans_FCVT_sh(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvt_sh);
 -}
 +TRANS_FEAT(BFCVT, aa64_sve_bf16, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_bfcvt, a, 0, FPST_FPCR)
 -static bool trans_FCVT_hs(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvt_hs);
 -}
 +TRANS_FEAT(FCVT_dh, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvt_dh, a, 0, FPST_FPCR)
 +TRANS_FEAT(FCVT_hd, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvt_hd, a, 0, FPST_FPCR)
 +TRANS_FEAT(FCVT_ds, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvt_ds, a, 0, FPST_FPCR)
 +TRANS_FEAT(FCVT_sd, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvt_sd, a, 0, FPST_FPCR)
 -static bool trans_BFCVT(DisasContext *s, arg_rpr_esz *a)
 -{
 -    if (!dc_isar_feature(aa64_sve_bf16, s)) {
 -        return false;
 -    }
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_bfcvt);
 -}
 +TRANS_FEAT(FCVTZS_hh, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvtzs_hh, a, 0, FPST_FPCR_F16)
 +TRANS_FEAT(FCVTZU_hh, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvtzu_hh, a, 0, FPST_FPCR_F16)
 +TRANS_FEAT(FCVTZS_hs, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvtzs_hs, a, 0, FPST_FPCR_F16)
 +TRANS_FEAT(FCVTZU_hs, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvtzu_hs, a, 0, FPST_FPCR_F16)
 +TRANS_FEAT(FCVTZS_hd, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvtzs_hd, a, 0, FPST_FPCR_F16)
 +TRANS_FEAT(FCVTZU_hd, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvtzu_hd, a, 0, FPST_FPCR_F16)
 -static bool trans_FCVT_dh(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvt_dh);
 -}
 +TRANS_FEAT(FCVTZS_ss, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvtzs_ss, a, 0, FPST_FPCR)
 +TRANS_FEAT(FCVTZU_ss, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvtzu_ss, a, 0, FPST_FPCR)
 +TRANS_FEAT(FCVTZS_sd, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvtzs_sd, a, 0, FPST_FPCR)
 +TRANS_FEAT(FCVTZU_sd, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvtzu_sd, a, 0, FPST_FPCR)
 +TRANS_FEAT(FCVTZS_ds, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvtzs_ds, a, 0, FPST_FPCR)
 +TRANS_FEAT(FCVTZU_ds, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvtzu_ds, a, 0, FPST_FPCR)
 -static bool trans_FCVT_hd(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvt_hd);
 -}
 -
 -static bool trans_FCVT_ds(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvt_ds);
 -}
 -
 -static bool trans_FCVT_sd(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvt_sd);
 -}
 -
 -static bool trans_FCVTZS_hh(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzs_hh);
 -}
 -
 -static bool trans_FCVTZU_hh(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzu_hh);
 -}
 -
 -static bool trans_FCVTZS_hs(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzs_hs);
 -}
 -
 -static bool trans_FCVTZU_hs(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzu_hs);
 -}
 -
 -static bool trans_FCVTZS_hd(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzs_hd);
 -}
 -
 -static bool trans_FCVTZU_hd(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzu_hd);
 -}
 -
 -static bool trans_FCVTZS_ss(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzs_ss);
 -}
 -
 -static bool trans_FCVTZU_ss(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzu_ss);
 -}
 -
 -static bool trans_FCVTZS_sd(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzs_sd);
 -}
 -
 -static bool trans_FCVTZU_sd(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzu_sd);
 -}
 -
 -static bool trans_FCVTZS_ds(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzs_ds);
 -}
 -
 -static bool trans_FCVTZU_ds(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzu_ds);
 -}
 -
 -static bool trans_FCVTZS_dd(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzs_dd);
 -}
 -
 -static bool trans_FCVTZU_dd(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzu_dd);
 -}
 +TRANS_FEAT(FCVTZS_dd, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvtzs_dd, a, 0, FPST_FPCR)
 +TRANS_FEAT(FCVTZU_dd, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_fcvtzu_dd, a, 0, FPST_FPCR)
  static gen_helper_gvec_3_ptr * const frint_fns[] = {
      NULL,
@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_3_ptr * const frint_fns[] = {
      gen_helper_sve_frint_s,
      gen_helper_sve_frint_d
  };
 +TRANS_FEAT(FRINTI, aa64_sve, gen_gvec_fpst_arg_zpz, frint_fns[a->esz],
 +           a, 0, a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR)
 -static bool trans_FRINTI(DisasContext *s, arg_rpr_esz *a)
 -{
 -    if (a->esz == 0) {
 -        return false;
 -    }
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, a->esz == MO_16,
 -                      frint_fns[a->esz]);
 -}
 -
 -static bool trans_FRINTX(DisasContext *s, arg_rpr_esz *a)
 -{
 -    static gen_helper_gvec_3_ptr * const fns[3] = {
 -        gen_helper_sve_frintx_h,
 -        gen_helper_sve_frintx_s,
 -        gen_helper_sve_frintx_d
 -    };
 -    if (a->esz == 0) {
 -        return false;
 -    }
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, a->esz == MO_16, fns[a->esz - 1]);
 -}
 +static gen_helper_gvec_3_ptr * const frintx_fns[] = {
 +    NULL,
 +    gen_helper_sve_frintx_h,
 +    gen_helper_sve_frintx_s,
 +    gen_helper_sve_frintx_d
 +};
 +TRANS_FEAT(FRINTX, aa64_sve, gen_gvec_fpst_arg_zpz, frintx_fns[a->esz],
 +           a, 0, a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
  static bool do_frint_mode(DisasContext *s, arg_rpr_esz *a,
                            int mode, gen_helper_gvec_3_ptr *fn)
@@ -XXX,XX +XXX,XX @@ static bool trans_FRINTA(DisasContext *s, arg_rpr_esz *a)
      return do_frint_mode(s, a, float_round_ties_away, frint_fns[a->esz]);
  }
 -static bool trans_FRECPX(DisasContext *s, arg_rpr_esz *a)
 -{
 -    static gen_helper_gvec_3_ptr * const fns[3] = {
 -        gen_helper_sve_frecpx_h,
 -        gen_helper_sve_frecpx_s,
 -        gen_helper_sve_frecpx_d
 -    };
 -    if (a->esz == 0) {
 -        return false;
 -    }
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, a->esz == MO_16, fns[a->esz - 1]);
 -}
 +static gen_helper_gvec_3_ptr * const frecpx_fns[] = {
 +    NULL,                    gen_helper_sve_frecpx_h,
 +    gen_helper_sve_frecpx_s, gen_helper_sve_frecpx_d,
 +};
 +TRANS_FEAT(FRECPX, aa64_sve, gen_gvec_fpst_arg_zpz, frecpx_fns[a->esz],
 +           a, 0, a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR)
 -static bool trans_FSQRT(DisasContext *s, arg_rpr_esz *a)
 -{
 -    static gen_helper_gvec_3_ptr * const fns[3] = {
 -        gen_helper_sve_fsqrt_h,
 -        gen_helper_sve_fsqrt_s,
 -        gen_helper_sve_fsqrt_d
 -    };
 -    if (a->esz == 0) {
 -        return false;
 -    }
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, a->esz == MO_16, fns[a->esz - 1]);
 -}
 +static gen_helper_gvec_3_ptr * const fsqrt_fns[] = {
 +    NULL,                   gen_helper_sve_fsqrt_h,
 +    gen_helper_sve_fsqrt_s, gen_helper_sve_fsqrt_d,
 +};
 +TRANS_FEAT(FSQRT, aa64_sve, gen_gvec_fpst_arg_zpz, fsqrt_fns[a->esz],
 +           a, 0, a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR)
 -static bool trans_SCVTF_hh(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_scvt_hh);
 -}
 +TRANS_FEAT(SCVTF_hh, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_scvt_hh, a, 0, FPST_FPCR_F16)
 +TRANS_FEAT(SCVTF_sh, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_scvt_sh, a, 0, FPST_FPCR_F16)
 +TRANS_FEAT(SCVTF_dh, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_scvt_dh, a, 0, FPST_FPCR_F16)
 -static bool trans_SCVTF_sh(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_scvt_sh);
 -}
 +TRANS_FEAT(SCVTF_ss, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_scvt_ss, a, 0, FPST_FPCR)
 +TRANS_FEAT(SCVTF_ds, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_scvt_ds, a, 0, FPST_FPCR)
 -static bool trans_SCVTF_dh(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_scvt_dh);
 -}
 +TRANS_FEAT(SCVTF_sd, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_scvt_sd, a, 0, FPST_FPCR)
 +TRANS_FEAT(SCVTF_dd, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_scvt_dd, a, 0, FPST_FPCR)
 -static bool trans_SCVTF_ss(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_scvt_ss);
 -}
 +TRANS_FEAT(UCVTF_hh, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_ucvt_hh, a, 0, FPST_FPCR_F16)
 +TRANS_FEAT(UCVTF_sh, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_ucvt_sh, a, 0, FPST_FPCR_F16)
 +TRANS_FEAT(UCVTF_dh, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_ucvt_dh, a, 0, FPST_FPCR_F16)
 -static bool trans_SCVTF_ds(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_scvt_ds);
 -}
 +TRANS_FEAT(UCVTF_ss, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_ucvt_ss, a, 0, FPST_FPCR)
 +TRANS_FEAT(UCVTF_ds, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_ucvt_ds, a, 0, FPST_FPCR)
 +TRANS_FEAT(UCVTF_sd, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_ucvt_sd, a, 0, FPST_FPCR)
 -static bool trans_SCVTF_sd(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_scvt_sd);
 -}
 -
 -static bool trans_SCVTF_dd(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_scvt_dd);
 -}
 -
 -static bool trans_UCVTF_hh(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_ucvt_hh);
 -}
 -
 -static bool trans_UCVTF_sh(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_ucvt_sh);
 -}
 -
 -static bool trans_UCVTF_dh(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_ucvt_dh);
 -}
 -
 -static bool trans_UCVTF_ss(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_ucvt_ss);
 -}
 -
 -static bool trans_UCVTF_ds(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_ucvt_ds);
 -}
 -
 -static bool trans_UCVTF_sd(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_ucvt_sd);
 -}
 -
 -static bool trans_UCVTF_dd(DisasContext *s, arg_rpr_esz *a)
 -{
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_ucvt_dd);
 -}
 +TRANS_FEAT(UCVTF_dd, aa64_sve, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_ucvt_dd, a, 0, FPST_FPCR)
  /*
   *** SVE Memory - 32-bit Gather and Unsized Contiguous Group
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(SM4EKEY, aa64_sve2_sm4, gen_gvec_ool_arg_zzz,
  TRANS_FEAT(RAX1, aa64_sve2_sha3, gen_gvec_fn_arg_zzz, gen_gvec_rax1, a)
 -static bool trans_FCVTNT_sh(DisasContext *s, arg_rpr_esz *a)
 -{
 -    if (!dc_isar_feature(aa64_sve2, s)) {
 -        return false;
 -    }
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve2_fcvtnt_sh);
 -}
 +TRANS_FEAT(FCVTNT_sh, aa64_sve2, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve2_fcvtnt_sh, a, 0, FPST_FPCR)
 +TRANS_FEAT(FCVTNT_ds, aa64_sve2, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve2_fcvtnt_ds, a, 0, FPST_FPCR)
 -static bool trans_BFCVTNT(DisasContext *s, arg_rpr_esz *a)
 -{
 -    if (!dc_isar_feature(aa64_sve_bf16, s)) {
 -        return false;
 -    }
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_bfcvtnt);
 -}
 +TRANS_FEAT(BFCVTNT, aa64_sve_bf16, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve_bfcvtnt, a, 0, FPST_FPCR)
 -static bool trans_FCVTNT_ds(DisasContext *s, arg_rpr_esz *a)
 -{
 -    if (!dc_isar_feature(aa64_sve2, s)) {
 -        return false;
 -    }
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve2_fcvtnt_ds);
 -}
 -
 -static bool trans_FCVTLT_hs(DisasContext *s, arg_rpr_esz *a)
 -{
 -    if (!dc_isar_feature(aa64_sve2, s)) {
 -        return false;
 -    }
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve2_fcvtlt_hs);
 -}
 -
 -static bool trans_FCVTLT_sd(DisasContext *s, arg_rpr_esz *a)
 -{
 -    if (!dc_isar_feature(aa64_sve2, s)) {
 -        return false;
 -    }
 -    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve2_fcvtlt_sd);
 -}
 +TRANS_FEAT(FCVTLT_hs, aa64_sve2, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve2_fcvtlt_hs, a, 0, FPST_FPCR)
 +TRANS_FEAT(FCVTLT_sd, aa64_sve2, gen_gvec_fpst_arg_zpz,
 +           gen_helper_sve2_fcvtlt_sd, a, 0, FPST_FPCR)
  static bool trans_FCVTX_ds(DisasContext *s, arg_rpr_esz *a)
  {
-     return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) != 0;
-diff --git a/linux-user/elfload.c b/linux-user/elfload.c
-index XXXXXXX..XXXXXXX 100644
---- a/linux-user/elfload.c
-+++ b/linux-user/elfload.c
-@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
-     GET_FEATURE(ARM_FEATURE_VFP3, ARM_HWCAP_ARM_VFPv3);
-     GET_FEATURE(ARM_FEATURE_V6K, ARM_HWCAP_ARM_TLS);
-     GET_FEATURE(ARM_FEATURE_VFP4, ARM_HWCAP_ARM_VFPv4);
--    GET_FEATURE(ARM_FEATURE_ARM_DIV, ARM_HWCAP_ARM_IDIVA);
--    GET_FEATURE(ARM_FEATURE_THUMB_DIV, ARM_HWCAP_ARM_IDIVT);
-+    GET_FEATURE_ID(arm_div, ARM_HWCAP_ARM_IDIVA);
-+    GET_FEATURE_ID(thumb_div, ARM_HWCAP_ARM_IDIVT);
-     /* All QEMU's VFPv3 CPUs have 32 registers, see VFP_DREG in translate.c.
-      * Note that the ARM_HWCAP_ARM_VFPv3D16 bit is always the inverse of
-      * ARM_HWCAP_ARM_VFPD32 (and so always clear for QEMU); it is unrelated
-diff --git a/target/arm/cpu.c b/target/arm/cpu.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.c
-+++ b/target/arm/cpu.c
-@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
-          * Presence of EL2 itself is ARM_FEATURE_EL2, and of the
-          * Security Extensions is ARM_FEATURE_EL3.
-          */
--        set_feature(env, ARM_FEATURE_ARM_DIV);
-+        assert(cpu_isar_feature(arm_div, cpu));
-         set_feature(env, ARM_FEATURE_LPAE);
-         set_feature(env, ARM_FEATURE_V7);
-     }
-@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
-     if (arm_feature(env, ARM_FEATURE_V5)) {
-         set_feature(env, ARM_FEATURE_V4T);
-     }
--    if (arm_feature(env, ARM_FEATURE_M)) {
--        set_feature(env, ARM_FEATURE_THUMB_DIV);
--    }
--    if (arm_feature(env, ARM_FEATURE_ARM_DIV)) {
--        set_feature(env, ARM_FEATURE_THUMB_DIV);
--    }
-     if (arm_feature(env, ARM_FEATURE_VFP4)) {
-         set_feature(env, ARM_FEATURE_VFP3);
-         set_feature(env, ARM_FEATURE_VFP_FP16);
-@@ -XXX,XX +XXX,XX @@ static void cortex_r5_initfn(Object *obj)
-     ARMCPU *cpu = ARM_CPU(obj);
-     set_feature(&cpu->env, ARM_FEATURE_V7);
--    set_feature(&cpu->env, ARM_FEATURE_THUMB_DIV);
--    set_feature(&cpu->env, ARM_FEATURE_ARM_DIV);
-     set_feature(&cpu->env, ARM_FEATURE_V7MP);
-     set_feature(&cpu->env, ARM_FEATURE_PMSA);
-     cpu->midr = 0x411fc153; /* r1p3 */
-diff --git a/target/arm/translate.c b/target/arm/translate.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.c
-+++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static void disas_arm_insn(DisasContext *s, unsigned int insn)
-                     case 1:
-                     case 3:
-                         /* SDIV, UDIV */
--                        if (!arm_dc_feature(s, ARM_FEATURE_ARM_DIV)) {
-+                        if (!dc_isar_feature(arm_div, s)) {
-                             goto illegal_op;
-                         }
-                         if (((insn >> 5) & 7) || (rd != 15)) {
-@@ -XXX,XX +XXX,XX @@ static void disas_thumb2_insn(DisasContext *s, uint32_t insn)
-             tmp2 = load_reg(s, rm);
-             if ((op & 0x50) == 0x10) {
-                 /* sdiv, udiv */
--                if (!arm_dc_feature(s, ARM_FEATURE_THUMB_DIV)) {
-+                if (!dc_isar_feature(thumb_div, s)) {
-                     goto illegal_op;
-                 }
-                 if (op & 0x20)
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 14/45] target/arm: Implement HCR.DC
+[PULL 097/117] target/arm: Move null function and sve check into do_frint_mode
-The HCR.DC virtualization configuration register bit has the
+From: Richard Henderson <richard.henderson@linaro.org>
 following effects:
  * SCTLR.M behaves as if it is 0 for all purposes except
    direct reads of the bit
  * HCR.VM behaves as if it is 1 for all purposes except
    direct reads of the bit
  * the memory type produced by the first stage of the EL1&EL0
    translation regime is Normal Non-Shareable,
    Inner Write-Back Read-Allocate Write-Allocate,
    Outer Write-Back Read-Allocate Write-Allocate.
-Implement this behaviour.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20220527181907.189259-95-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/translate-sve.c | 52 +++++++++++++++++---------------------
 file changed, 23 insertions(+), 29 deletions(-)
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20181012144235.19646-5-peter.maydell@linaro.org
 ---
  target/arm/helper.c | 23 +++++++++++++++++++++--
 file changed, 21 insertions(+), 2 deletions(-)
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/helper.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static uint64_t do_ats_write(CPUARMState *env, uint64_t value,
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(FRINTX, aa64_sve, gen_gvec_fpst_arg_zpz, frintx_fns[a->esz],
-          * * The Non-secure TTBCR.EAE bit is set to 1
+ static bool do_frint_mode(DisasContext *s, arg_rpr_esz *a,
-          * * The implementation includes EL2, and the value of HCR.VM is 1
+                           int mode, gen_helper_gvec_3_ptr *fn)
-          *
+ {
-+         * (Note that HCR.DC makes HCR.VM behave as if it is 1.)
+-    if (sve_access_check(s)) {
-+         *
+-        unsigned vsz = vec_full_reg_size(s);
-          * ATS1Hx always uses the 64bit format (not supported yet).
+-        TCGv_i32 tmode = tcg_const_i32(mode);
-          */
+-        TCGv_ptr status = fpstatus_ptr(a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
-         format64 = arm_s1_regime_using_lpae_format(env, mmu_idx);
++    unsigned vsz;
++    TCGv_i32 tmode;
-         if (arm_feature(env, ARM_FEATURE_EL2)) {
++    TCGv_ptr status;
-             if (mmu_idx == ARMMMUIdx_S12NSE0 || mmu_idx == ARMMMUIdx_S12NSE1) {
--                format64 |= env->cp15.hcr_el2 & HCR_VM;
+-        gen_helper_set_rmode(tmode, tmode, status);
-+                format64 |= env->cp15.hcr_el2 & (HCR_VM | HCR_DC);
+-
-             } else {
+-        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, a->rd),
-                 format64 |= arm_current_el(env) == 2;
+-                           vec_full_reg_offset(s, a->rn),
-             }
+-                           pred_full_reg_offset(s, a->pg),
-@@ -XXX,XX +XXX,XX @@ static inline bool regime_translation_disabled(CPUARMState *env,
+-                           status, vsz, vsz, 0, fn);
 -
 -        gen_helper_set_rmode(tmode, tmode, status);
 -        tcg_temp_free_i32(tmode);
 -        tcg_temp_free_ptr(status);
 +    if (fn == NULL) {
 +        return false;
      }
++    if (!sve_access_check(s)) {
      if (mmu_idx == ARMMMUIdx_S2NS) {
 -        return (env->cp15.hcr_el2 & HCR_VM) == 0;
 +        /* HCR.DC means HCR.VM behaves as 1 */
 +        return (env->cp15.hcr_el2 & (HCR_DC | HCR_VM)) == 0;
      }
      if (env->cp15.hcr_el2 & HCR_TGE) {
@@ -XXX,XX +XXX,XX @@ static inline bool regime_translation_disabled(CPUARMState *env,
          }
      }
 +    if ((env->cp15.hcr_el2 & HCR_DC) &&
 +        (mmu_idx == ARMMMUIdx_S1NSE0 || mmu_idx == ARMMMUIdx_S1NSE1)) {
 +        /* HCR.DC means SCTLR_EL1.M behaves as 0 */
 +        return true;
 +    }
 +
-     return (regime_sctlr(env, mmu_idx) & SCTLR_M) == 0;
++    vsz = vec_full_reg_size(s);
 +    tmode = tcg_const_i32(mode);
 +    status = fpstatus_ptr(a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
 +
 +    gen_helper_set_rmode(tmode, tmode, status);
 +
 +    tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, a->rd),
 +                       vec_full_reg_offset(s, a->rn),
 +                       pred_full_reg_offset(s, a->pg),
 +                       status, vsz, vsz, 0, fn);
 +
 +    gen_helper_set_rmode(tmode, tmode, status);
 +    tcg_temp_free_i32(tmode);
 +    tcg_temp_free_ptr(status);
      return true;
  }
-@@ -XXX,XX +XXX,XX @@ static bool get_phys_addr(CPUARMState *env, target_ulong address,
+ static bool trans_FRINTN(DisasContext *s, arg_rpr_esz *a)
+ {
-             /* Combine the S1 and S2 cache attributes, if needed */
+-    if (a->esz == 0) {
-             if (!ret && cacheattrs != NULL) {
+-        return false;
-+                if (env->cp15.hcr_el2 & HCR_DC) {
+-    }
-+                    /*
+     return do_frint_mode(s, a, float_round_nearest_even, frint_fns[a->esz]);
-+                     * HCR.DC forces the first stage attributes to
+ }
-+                     *  Normal Non-Shareable,
-+                     *  Inner Write-Back Read-Allocate Write-Allocate,
+ static bool trans_FRINTP(DisasContext *s, arg_rpr_esz *a)
-+                     *  Outer Write-Back Read-Allocate Write-Allocate.
+ {
-+                     */
+-    if (a->esz == 0) {
-+                    cacheattrs->attrs = 0xff;
+-        return false;
-+                    cacheattrs->shareability = 0;
+-    }
-+                }
+     return do_frint_mode(s, a, float_round_up, frint_fns[a->esz]);
-                 *cacheattrs = combine_cacheattrs(*cacheattrs, cacheattrs2);
+ }
-             }
  static bool trans_FRINTM(DisasContext *s, arg_rpr_esz *a)
  {
 -    if (a->esz == 0) {
 -        return false;
 -    }
      return do_frint_mode(s, a, float_round_down, frint_fns[a->esz]);
  }
  static bool trans_FRINTZ(DisasContext *s, arg_rpr_esz *a)
  {
 -    if (a->esz == 0) {
 -        return false;
 -    }
      return do_frint_mode(s, a, float_round_to_zero, frint_fns[a->esz]);
  }
  static bool trans_FRINTA(DisasContext *s, arg_rpr_esz *a)
  {
 -    if (a->esz == 0) {
 -        return false;
 -    }
      return do_frint_mode(s, a, float_round_ties_away, frint_fns[a->esz]);
  }
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 13/45] target/arm: Implement HCR.FB
+[PULL 098/117] target/arm: Use TRANS_FEAT for do_frint_mode
-The HCR.FB virtualization configuration register bit requests that
+From: Richard Henderson <richard.henderson@linaro.org>
 TLB maintenance, branch predictor invalidate-all and icache
 invalidate-all operations performed in NS EL1 should be upgraded
 from "local CPU only to "broadcast within Inner Shareable domain".
 For QEMU we NOP the branch predictor and icache operations, so
 we only need to upgrade the TLB invalidates:
  AArch32 TLBIALL, TLBIMVA, TLBIASID, DTLBIALL, DTLBIMVA, DTLBIASID,
          ITLBIALL, ITLBIMVA, ITLBIASID, TLBIMVAA, TLBIMVAL, TLBIMVAAL
  AArch64 TLBI VMALLE1, TLBI VAE1, TLBI ASIDE1, TLBI VAAE1,
          TLBI VALE1, TLBI VAALE1
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20220527181907.189259-96-richard.henderson@linaro.org
+Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181012144235.19646-4-peter.maydell@linaro.org
 ---
- target/arm/helper.c | 191 +++++++++++++++++++++++++++-----------------
+ target/arm/translate-sve.c | 53 ++++++++++----------------------------
-file changed, 116 insertions(+), 75 deletions(-)
+file changed, 14 insertions(+), 39 deletions(-)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/helper.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static void contextidr_write(CPUARMState *env, const ARMCPRegInfo *ri,
+@@ -XXX,XX +XXX,XX @@ static bool do_frint_mode(DisasContext *s, arg_rpr_esz *a,
-     raw_write(env, ri, value);
+     return true;
  }
--static void tlbiall_write(CPUARMState *env, const ARMCPRegInfo *ri,
+-static bool trans_FRINTN(DisasContext *s, arg_rpr_esz *a)
 -                          uint64_t value)
 -{
--    /* Invalidate all (TLBIALL) */
+-    return do_frint_mode(s, a, float_round_nearest_even, frint_fns[a->esz]);
 -    ARMCPU *cpu = arm_env_get_cpu(env);
 -
 -    tlb_flush(CPU(cpu));
 -}
 -
--static void tlbimva_write(CPUARMState *env, const ARMCPRegInfo *ri,
+-static bool trans_FRINTP(DisasContext *s, arg_rpr_esz *a)
 -                          uint64_t value)
 -{
--    /* Invalidate single TLB entry by MVA and ASID (TLBIMVA) */
+-    return do_frint_mode(s, a, float_round_up, frint_fns[a->esz]);
 -    ARMCPU *cpu = arm_env_get_cpu(env);
 -
 -    tlb_flush_page(CPU(cpu), value & TARGET_PAGE_MASK);
 -}
 -
--static void tlbiasid_write(CPUARMState *env, const ARMCPRegInfo *ri,
+-static bool trans_FRINTM(DisasContext *s, arg_rpr_esz *a)
 -                           uint64_t value)
 -{
--    /* Invalidate by ASID (TLBIASID) */
+-    return do_frint_mode(s, a, float_round_down, frint_fns[a->esz]);
 -    ARMCPU *cpu = arm_env_get_cpu(env);
 -
 -    tlb_flush(CPU(cpu));
 -}
 -
--static void tlbimvaa_write(CPUARMState *env, const ARMCPRegInfo *ri,
+-static bool trans_FRINTZ(DisasContext *s, arg_rpr_esz *a)
 -                           uint64_t value)
 -{
--    /* Invalidate single entry by MVA, all ASIDs (TLBIMVAA) */
+-    return do_frint_mode(s, a, float_round_to_zero, frint_fns[a->esz]);
 -    ARMCPU *cpu = arm_env_get_cpu(env);
 -
 -    tlb_flush_page(CPU(cpu), value & TARGET_PAGE_MASK);
 -}
 -
- /* IS variants of TLB operations must affect all cores */
+-static bool trans_FRINTA(DisasContext *s, arg_rpr_esz *a)
  static void tlbiall_is_write(CPUARMState *env, const ARMCPRegInfo *ri,
                               uint64_t value)
@@ -XXX,XX +XXX,XX @@ static void tlbimvaa_is_write(CPUARMState *env, const ARMCPRegInfo *ri,
      tlb_flush_page_all_cpus_synced(cs, value & TARGET_PAGE_MASK);
  }
 +/*
 + * Non-IS variants of TLB operations are upgraded to
 + * IS versions if we are at NS EL1 and HCR_EL2.FB is set to
 + * force broadcast of these operations.
 + */
 +static bool tlb_force_broadcast(CPUARMState *env)
 +{
 +    return (env->cp15.hcr_el2 & HCR_FB) &&
 +        arm_current_el(env) == 1 && arm_is_secure_below_el3(env);
 +}
 +
 +static void tlbiall_write(CPUARMState *env, const ARMCPRegInfo *ri,
 +                          uint64_t value)
 +{
 +    /* Invalidate all (TLBIALL) */
 +    ARMCPU *cpu = arm_env_get_cpu(env);
 +
 +    if (tlb_force_broadcast(env)) {
 +        tlbiall_is_write(env, NULL, value);
 +        return;
 +    }
 +
 +    tlb_flush(CPU(cpu));
 +}
 +
 +static void tlbimva_write(CPUARMState *env, const ARMCPRegInfo *ri,
 +                          uint64_t value)
 +{
 +    /* Invalidate single TLB entry by MVA and ASID (TLBIMVA) */
 +    ARMCPU *cpu = arm_env_get_cpu(env);
 +
 +    if (tlb_force_broadcast(env)) {
 +        tlbimva_is_write(env, NULL, value);
 +        return;
 +    }
 +
 +    tlb_flush_page(CPU(cpu), value & TARGET_PAGE_MASK);
 +}
 +
 +static void tlbiasid_write(CPUARMState *env, const ARMCPRegInfo *ri,
 +                           uint64_t value)
 +{
 +    /* Invalidate by ASID (TLBIASID) */
 +    ARMCPU *cpu = arm_env_get_cpu(env);
 +
 +    if (tlb_force_broadcast(env)) {
 +        tlbiasid_is_write(env, NULL, value);
 +        return;
 +    }
 +
 +    tlb_flush(CPU(cpu));
 +}
 +
 +static void tlbimvaa_write(CPUARMState *env, const ARMCPRegInfo *ri,
 +                           uint64_t value)
 +{
 +    /* Invalidate single entry by MVA, all ASIDs (TLBIMVAA) */
 +    ARMCPU *cpu = arm_env_get_cpu(env);
 +
 +    if (tlb_force_broadcast(env)) {
 +        tlbimvaa_is_write(env, NULL, value);
 +        return;
 +    }
 +
 +    tlb_flush_page(CPU(cpu), value & TARGET_PAGE_MASK);
 +}
 +
  static void tlbiall_nsnh_write(CPUARMState *env, const ARMCPRegInfo *ri,
                                 uint64_t value)
  {
@@ -XXX,XX +XXX,XX @@ static CPAccessResult aa64_cacheop_access(CPUARMState *env,
   * Page D4-1736 (DDI0487A.b)
   */
 -static void tlbi_aa64_vmalle1_write(CPUARMState *env, const ARMCPRegInfo *ri,
 -                                    uint64_t value)
 -{
--    CPUState *cs = ENV_GET_CPU(env);
+-    return do_frint_mode(s, a, float_round_ties_away, frint_fns[a->esz]);
--
+-}
--    if (arm_is_secure_below_el3(env)) {
++TRANS_FEAT(FRINTN, aa64_sve, do_frint_mode, a,
--        tlb_flush_by_mmuidx(cs,
++           float_round_nearest_even, frint_fns[a->esz])
--                            ARMMMUIdxBit_S1SE1 |
++TRANS_FEAT(FRINTP, aa64_sve, do_frint_mode, a,
--                            ARMMMUIdxBit_S1SE0);
++           float_round_up, frint_fns[a->esz])
--    } else {
++TRANS_FEAT(FRINTM, aa64_sve, do_frint_mode, a,
--        tlb_flush_by_mmuidx(cs,
++           float_round_down, frint_fns[a->esz])
--                            ARMMMUIdxBit_S12NSE1 |
++TRANS_FEAT(FRINTZ, aa64_sve, do_frint_mode, a,
--                            ARMMMUIdxBit_S12NSE0);
++           float_round_to_zero, frint_fns[a->esz])
 +TRANS_FEAT(FRINTA, aa64_sve, do_frint_mode, a,
 +           float_round_ties_away, frint_fns[a->esz])
  static gen_helper_gvec_3_ptr * const frecpx_fns[] = {
      NULL,                    gen_helper_sve_frecpx_h,
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(FCVTLT_hs, aa64_sve2, gen_gvec_fpst_arg_zpz,
  TRANS_FEAT(FCVTLT_sd, aa64_sve2, gen_gvec_fpst_arg_zpz,
             gen_helper_sve2_fcvtlt_sd, a, 0, FPST_FPCR)
 -static bool trans_FCVTX_ds(DisasContext *s, arg_rpr_esz *a)
 -{
 -    if (!dc_isar_feature(aa64_sve2, s)) {
 -        return false;
 -    }
+-    return do_frint_mode(s, a, float_round_to_odd, gen_helper_sve_fcvt_ds);
 -}
 -
- static void tlbi_aa64_vmalle1is_write(CPUARMState *env, const ARMCPRegInfo *ri,
+-static bool trans_FCVTXNT_ds(DisasContext *s, arg_rpr_esz *a)
                                        uint64_t value)
  {
@@ -XXX,XX +XXX,XX @@ static void tlbi_aa64_vmalle1is_write(CPUARMState *env, const ARMCPRegInfo *ri,
      }
  }
 +static void tlbi_aa64_vmalle1_write(CPUARMState *env, const ARMCPRegInfo *ri,
 +                                    uint64_t value)
 +{
 +    CPUState *cs = ENV_GET_CPU(env);
 +
 +    if (tlb_force_broadcast(env)) {
 +        tlbi_aa64_vmalle1_write(env, NULL, value);
 +        return;
 +    }
 +
 +    if (arm_is_secure_below_el3(env)) {
 +        tlb_flush_by_mmuidx(cs,
 +                            ARMMMUIdxBit_S1SE1 |
 +                            ARMMMUIdxBit_S1SE0);
 +    } else {
 +        tlb_flush_by_mmuidx(cs,
 +                            ARMMMUIdxBit_S12NSE1 |
 +                            ARMMMUIdxBit_S12NSE0);
 +    }
 +}
 +
  static void tlbi_aa64_alle1_write(CPUARMState *env, const ARMCPRegInfo *ri,
                                    uint64_t value)
  {
@@ -XXX,XX +XXX,XX @@ static void tlbi_aa64_alle3is_write(CPUARMState *env, const ARMCPRegInfo *ri,
      tlb_flush_by_mmuidx_all_cpus_synced(cs, ARMMMUIdxBit_S1E3);
  }
 -static void tlbi_aa64_vae1_write(CPUARMState *env, const ARMCPRegInfo *ri,
 -                                 uint64_t value)
 -{
--    /* Invalidate by VA, EL1&0 (AArch64 version).
+-    if (!dc_isar_feature(aa64_sve2, s)) {
--     * Currently handles all of VAE1, VAAE1, VAALE1 and VALE1,
+-        return false;
 -     * since we don't support flush-for-specific-ASID-only or
 -     * flush-last-level-only.
 -     */
 -    ARMCPU *cpu = arm_env_get_cpu(env);
 -    CPUState *cs = CPU(cpu);
 -    uint64_t pageaddr = sextract64(value << 12, 0, 56);
 -
 -    if (arm_is_secure_below_el3(env)) {
 -        tlb_flush_page_by_mmuidx(cs, pageaddr,
 -                                 ARMMMUIdxBit_S1SE1 |
 -                                 ARMMMUIdxBit_S1SE0);
 -    } else {
 -        tlb_flush_page_by_mmuidx(cs, pageaddr,
 -                                 ARMMMUIdxBit_S12NSE1 |
 -                                 ARMMMUIdxBit_S12NSE0);
 -    }
+-    return do_frint_mode(s, a, float_round_to_odd, gen_helper_sve2_fcvtnt_ds);
 -}
--
++TRANS_FEAT(FCVTX_ds, aa64_sve2, do_frint_mode, a,
- static void tlbi_aa64_vae2_write(CPUARMState *env, const ARMCPRegInfo *ri,
++           float_round_to_odd, gen_helper_sve_fcvt_ds)
-                                  uint64_t value)
++TRANS_FEAT(FCVTXNT_ds, aa64_sve2, do_frint_mode, a,
- {
++           float_round_to_odd, gen_helper_sve2_fcvtnt_ds)
-@@ -XXX,XX +XXX,XX @@ static void tlbi_aa64_vae1is_write(CPUARMState *env, const ARMCPRegInfo *ri,
-     }
+ static bool trans_FLOGB(DisasContext *s, arg_rpr_esz *a)
  }
 +static void tlbi_aa64_vae1_write(CPUARMState *env, const ARMCPRegInfo *ri,
 +                                 uint64_t value)
 +{
 +    /* Invalidate by VA, EL1&0 (AArch64 version).
 +     * Currently handles all of VAE1, VAAE1, VAALE1 and VALE1,
 +     * since we don't support flush-for-specific-ASID-only or
 +     * flush-last-level-only.
 +     */
 +    ARMCPU *cpu = arm_env_get_cpu(env);
 +    CPUState *cs = CPU(cpu);
 +    uint64_t pageaddr = sextract64(value << 12, 0, 56);
 +
 +    if (tlb_force_broadcast(env)) {
 +        tlbi_aa64_vae1is_write(env, NULL, value);
 +        return;
 +    }
 +
 +    if (arm_is_secure_below_el3(env)) {
 +        tlb_flush_page_by_mmuidx(cs, pageaddr,
 +                                 ARMMMUIdxBit_S1SE1 |
 +                                 ARMMMUIdxBit_S1SE0);
 +    } else {
 +        tlb_flush_page_by_mmuidx(cs, pageaddr,
 +                                 ARMMMUIdxBit_S12NSE1 |
 +                                 ARMMMUIdxBit_S12NSE0);
 +    }
 +}
 +
  static void tlbi_aa64_vae2is_write(CPUARMState *env, const ARMCPRegInfo *ri,
                                     uint64_t value)
  {
 --
-.19.1
+.25.1

-[Qemu-devel] [PULL 24/45] target/arm: Use tcg_gen_gvec_dup_i64 for LD[1-4]R
+[PULL 099/117] target/arm: Use TRANS_FEAT for FLOGB
 From: Richard Henderson <richard.henderson@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20181011205206.3552-4-richard.henderson@linaro.org
+Message-id: 20220527181907.189259-97-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate-a64.c | 28 +++-------------------------
+ target/arm/translate-sve.c | 29 ++++++-----------------------
-file changed, 3 insertions(+), 25 deletions(-)
+file changed, 6 insertions(+), 23 deletions(-)
-diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
+diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-a64.c
+--- a/target/arm/translate-sve.c
-+++ b/target/arm/translate-a64.c
++++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(FCVTX_ds, aa64_sve2, do_frint_mode, a,
-     for (xs = 0; xs < selem; xs++) {
+ TRANS_FEAT(FCVTXNT_ds, aa64_sve2, do_frint_mode, a,
-         if (replicate) {
+            float_round_to_odd, gen_helper_sve2_fcvtnt_ds)
-             /* Load and replicate to all elements */
--            uint64_t mulconst;
+-static bool trans_FLOGB(DisasContext *s, arg_rpr_esz *a)
-             TCGv_i64 tcg_tmp = tcg_temp_new_i64();
+-{
+-    static gen_helper_gvec_3_ptr * const fns[] = {
-             tcg_gen_qemu_ld_i64(tcg_tmp, tcg_addr,
+-        NULL,               gen_helper_flogb_h,
-                                 get_mem_index(s), s->be_data + scale);
+-        gen_helper_flogb_s, gen_helper_flogb_d
--            switch (scale) {
+-    };
--            case 0:
+-
--                mulconst = 0x0101010101010101ULL;
+-    if (!dc_isar_feature(aa64_sve2, s) || fns[a->esz] == NULL) {
--                break;
+-        return false;
--            case 1:
+-    }
--                mulconst = 0x0001000100010001ULL;
+-    if (sve_access_check(s)) {
--                break;
+-        TCGv_ptr status =
--            case 2:
+-            fpstatus_ptr(a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
--                mulconst = 0x0000000100000001ULL;
+-        unsigned vsz = vec_full_reg_size(s);
--                break;
+-
--            case 3:
+-        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, a->rd),
--                mulconst = 0;
+-                           vec_full_reg_offset(s, a->rn),
--                break;
+-                           pred_full_reg_offset(s, a->pg),
--            default:
+-                           status, vsz, vsz, 0, fns[a->esz]);
--                g_assert_not_reached();
+-        tcg_temp_free_ptr(status);
--            }
+-    }
--            if (mulconst) {
+-    return true;
--                tcg_gen_muli_i64(tcg_tmp, tcg_tmp, mulconst);
+-}
--            }
++static gen_helper_gvec_3_ptr * const flogb_fns[] = {
--            write_vec_element(s, tcg_tmp, rt, 0, MO_64);
++    NULL,               gen_helper_flogb_h,
--            if (is_q) {
++    gen_helper_flogb_s, gen_helper_flogb_d
--                write_vec_element(s, tcg_tmp, rt, 1, MO_64);
++};
--            }
++TRANS_FEAT(FLOGB, aa64_sve2, gen_gvec_fpst_arg_zpz, flogb_fns[a->esz],
-+            tcg_gen_gvec_dup_i64(scale, vec_full_reg_offset(s, rt),
++           a, 0, a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR)
-+                                 (is_q + 1) * 8, vec_full_reg_size(s),
-+                                 tcg_tmp);
+ static bool do_FMLAL_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sub, bool sel)
-             tcg_temp_free_i64(tcg_tmp);
+ {
 -            clear_vec_high(s, is_q, rt);
          } else {
              /* Load/store one element per register */
              if (is_load) {
 --
-.19.1
+.25.1

As promised, another pullreq... This one's mostly RTH's patches.

thanks
-- PMM

The following changes since commit 784c2e4f232adf5ef47a84a262ec72a07d068d6a:

Merge remote-tracking branch 'remotes/jasowang/tags/net-pull-request' into staging (2018-10-19 15:30:40 +0100)

are available in the Git repository at:

https://git.linaro.org/people/pmaydell/qemu-arm.git tags/pull-target-arm-20181019

for you to fetch changes up to 88c9add25e7120e8622796c81ad3f3fb7f8d40e7:

target/arm: Only flush tlb if ASID changes (2018-10-19 17:38:48 +0100)

----------------------------------------------------------------
target-arm queue:
 * ssi-sd: Make devices picking up backends unavailable with -device
 * Add support for VCPU event states
 * Move towards making ID registers the source of truth for
   whether a guest CPU implements a feature, rather than having
   parallel ID registers and feature bit flags
 * Implement various HCR hypervisor trap/config bits
 * Get IL bit correct for v7 syndrome values
 * Report correct syndrome for FP/SIMD traps to Hyp mode
 * hw/arm/boot: Increase compliance with kernel arm64 boot protocol
 * Refactor A32 Neon to use generic vector infrastructure
 * Fix a bug in A32 VLD2 "(multiple 2-element structures)" insn
 * net: cadence_gem: Report features correctly in ID register
 * Avoid some unnecessary TLB flushes on TTBR register writes

----------------------------------------------------------------
Dongjiu Geng (1):
      target/arm: Add support for VCPU event states

Edgar E. Iglesias (2):
      net: cadence_gem: Announce availability of priority queues
      net: cadence_gem: Announce 64bit addressing support

Markus Armbruster (1):
      ssi-sd: Make devices picking up backends unavailable with -device

Peter Maydell (10):
      target/arm: Improve debug logging of AArch32 exception return
      target/arm: Make switch_mode() file-local
      target/arm: Implement HCR.FB
      target/arm: Implement HCR.DC
      target/arm: ISR_EL1 bits track virtual interrupts if IMO/FMO set
      target/arm: Implement HCR.VI and VF
      target/arm: Implement HCR.PTW
      target/arm: New utility function to extract EC from syndrome
      target/arm: Get IL bit correct for v7 syndrome values
      target/arm: Report correct syndrome for FP/SIMD traps to Hyp mode

Richard Henderson (30):
      target/arm: Move some system registers into a substructure
      target/arm: V8M should not imply V7VE
      target/arm: Convert v8 extensions from feature bits to isar tests
      target/arm: Convert division from feature bits to isar0 tests
      target/arm: Convert jazelle from feature bit to isar1 test
      target/arm: Convert t32ee from feature bit to isar3 test
      target/arm: Convert sve from feature bit to aa64pfr0 test
      target/arm: Convert v8.2-fp16 from feature bit to aa64pfr0 test
      target/arm: Hoist address increment for vector memory ops
      target/arm: Don't call tcg_clear_temp_count
      target/arm: Use tcg_gen_gvec_dup_i64 for LD[1-4]R
      target/arm: Promote consecutive memory ops for aa64
      target/arm: Mark some arrays const
      target/arm: Use gvec for NEON VDUP
      target/arm: Use gvec for NEON VMOV, VMVN, VBIC & VORR (immediate)
      target/arm: Use gvec for NEON_3R_LOGIC insns
      target/arm: Use gvec for NEON_3R_VADD_VSUB insns
      target/arm: Use gvec for NEON_2RM_VMN, NEON_2RM_VNEG
      target/arm: Use gvec for NEON_3R_VMUL
      target/arm: Use gvec for VSHR, VSHL
      target/arm: Use gvec for VSRA
      target/arm: Use gvec for VSRI, VSLI
      target/arm: Use gvec for NEON_3R_VML
      target/arm: Use gvec for NEON_3R_VTST_VCEQ, NEON_3R_VCGT, NEON_3R_VCGE
      target/arm: Use gvec for NEON VLD all lanes
      target/arm: Reorg NEON VLD/VST all elements
      target/arm: Promote consecutive memory ops for aa32
      target/arm: Reorg NEON VLD/VST single element to one lane
      target/arm: Remove writefn from TTBR0_EL3
      target/arm: Only flush tlb if ASID changes

Stewart Hildebrand (1):
      hw/arm/boot: Increase compliance with kernel arm64 boot protocol

From: Markus Armbruster <armbru@redhat.com>

Device models aren't supposed to go on fishing expeditions for
backends.  They should expose suitable properties for the user to set.
For onboard devices, board code sets them.

Device ssi-sd picks up its block backend in its init() method with
drive_get_next() instead.  This mistake is already marked FIXME since
commit af9e40a.

Unset user_creatable to remove the mistake from our external
interface.  Since the SSI bus doesn't support hotplug, only -device
can be affected.  Only certain ARM machines have ssi-sd and provide an
SSI bus for it; this patch breaks -device ssi-sd for these machines.
No actual use of -device ssi-sd is known.

Signed-off-by: Markus Armbruster <armbru@redhat.com>
Acked-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Acked-by: Thomas Huth <thuth@redhat.com>
Message-id: 20181009060835.4608-1-armbru@redhat.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/sd/ssi-sd.c | 2 ++
 1 file changed, 2 insertions(+)

diff --git a/hw/sd/ssi-sd.c b/hw/sd/ssi-sd.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/sd/ssi-sd.c
+++ b/hw/sd/ssi-sd.c
@@ -XXX,XX +XXX,XX @@ static void ssi_sd_class_init(ObjectClass *klass, void *data)
     k->cs_polarity = SSI_CS_LOW;
     dc->vmsd = &vmstate_ssi_sd;
     dc->reset = ssi_sd_reset;
+    /* Reason: init() method uses drive_get_next() */
+    dc->user_creatable = false;
 }
 
 static const TypeInfo ssi_sd_info = {
-- 
2.19.1

From: Dongjiu Geng <gengdongjiu@huawei.com>

This patch extends the qemu-kvm state sync logic with support for
KVM_GET/SET_VCPU_EVENTS, giving access to yet missing SError exception.
And also it can support the exception state migration.

The SError exception states include SError pending state and ESR value,
the kvm_put/get_vcpu_events() will be called when set or get system
registers. When do migration, if source machine has SError pending,
QEMU will do this migration regardless whether the target machine supports
to specify guest ESR value, because if target machine does not support that,
it can also inject the SError with zero ESR value.

Signed-off-by: Dongjiu Geng <gengdongjiu@huawei.com>
Reviewed-by: Andrew Jones <drjones@redhat.com>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 1538067351-23931-3-git-send-email-gengdongjiu@huawei.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h     |  7 ++++++
 target/arm/kvm_arm.h | 24 ++++++++++++++++++
 target/arm/kvm.c     | 60 ++++++++++++++++++++++++++++++++++++++++++++
 target/arm/kvm32.c   | 13 ++++++++++
 target/arm/kvm64.c   | 13 ++++++++++
 target/arm/machine.c | 22 ++++++++++++++++
 6 files changed, 139 insertions(+)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ typedef struct CPUARMState {
          */
     } exception;
 
+    /* Information associated with an SError */
+    struct {
+        uint8_t pending;
+        uint8_t has_esr;
+        uint64_t esr;
+    } serror;
+
     /* Thumb-2 EE state.  */
     uint32_t teecr;
     uint32_t teehbr;
diff --git a/target/arm/kvm_arm.h b/target/arm/kvm_arm.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/kvm_arm.h
+++ b/target/arm/kvm_arm.h
@@ -XXX,XX +XXX,XX @@ bool write_kvmstate_to_list(ARMCPU *cpu);
  */
 void kvm_arm_reset_vcpu(ARMCPU *cpu);
 
+/**
+ * kvm_arm_init_serror_injection:
+ * @cs: CPUState
+ *
+ * Check whether KVM can set guest SError syndrome.
+ */
+void kvm_arm_init_serror_injection(CPUState *cs);
+
+/**
+ * kvm_get_vcpu_events:
+ * @cpu: ARMCPU
+ *
+ * Get VCPU related state from kvm.
+ */
+int kvm_get_vcpu_events(ARMCPU *cpu);
+
+/**
+ * kvm_put_vcpu_events:
+ * @cpu: ARMCPU
+ *
+ * Put VCPU related state to kvm.
+ */
+int kvm_put_vcpu_events(ARMCPU *cpu);
+
 #ifdef CONFIG_KVM
 /**
  * kvm_arm_create_scratch_host_vcpu:
diff --git a/target/arm/kvm.c b/target/arm/kvm.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/kvm.c
+++ b/target/arm/kvm.c
@@ -XXX,XX +XXX,XX @@ const KVMCapabilityInfo kvm_arch_required_capabilities[] = {
 };
 
 static bool cap_has_mp_state;
+static bool cap_has_inject_serror_esr;
 
 static ARMHostCPUFeatures arm_host_cpu_features;
 
@@ -XXX,XX +XXX,XX @@ int kvm_arm_vcpu_init(CPUState *cs)
     return kvm_vcpu_ioctl(cs, KVM_ARM_VCPU_INIT, &init);
 }
 
+void kvm_arm_init_serror_injection(CPUState *cs)
+{
+    cap_has_inject_serror_esr = kvm_check_extension(cs->kvm_state,
+                                    KVM_CAP_ARM_INJECT_SERROR_ESR);
+}
+
 bool kvm_arm_create_scratch_host_vcpu(const uint32_t *cpus_to_try,
                                       int *fdarray,
                                       struct kvm_vcpu_init *init)
@@ -XXX,XX +XXX,XX @@ int kvm_arm_sync_mpstate_to_qemu(ARMCPU *cpu)
     return 0;
 }
 
+int kvm_put_vcpu_events(ARMCPU *cpu)
+{
+    CPUARMState *env = &cpu->env;
+    struct kvm_vcpu_events events;
+    int ret;
+
+    if (!kvm_has_vcpu_events()) {
+        return 0;
+    }
+
+    memset(&events, 0, sizeof(events));
+    events.exception.serror_pending = env->serror.pending;
+
+    /* Inject SError to guest with specified syndrome if host kernel
+     * supports it, otherwise inject SError without syndrome.
+     */
+    if (cap_has_inject_serror_esr) {
+        events.exception.serror_has_esr = env->serror.has_esr;
+        events.exception.serror_esr = env->serror.esr;
+    }
+
+    ret = kvm_vcpu_ioctl(CPU(cpu), KVM_SET_VCPU_EVENTS, &events);
+    if (ret) {
+        error_report("failed to put vcpu events");
+    }
+
+    return ret;
+}
+
+int kvm_get_vcpu_events(ARMCPU *cpu)
+{
+    CPUARMState *env = &cpu->env;
+    struct kvm_vcpu_events events;
+    int ret;
+
+    if (!kvm_has_vcpu_events()) {
+        return 0;
+    }
+
+    memset(&events, 0, sizeof(events));
+    ret = kvm_vcpu_ioctl(CPU(cpu), KVM_GET_VCPU_EVENTS, &events);
+    if (ret) {
+        error_report("failed to get vcpu events");
+        return ret;
+    }
+
+    env->serror.pending = events.exception.serror_pending;
+    env->serror.has_esr = events.exception.serror_has_esr;
+    env->serror.esr = events.exception.serror_esr;
+
+    return 0;
+}
+
 void kvm_arch_pre_run(CPUState *cs, struct kvm_run *run)
 {
 }
diff --git a/target/arm/kvm32.c b/target/arm/kvm32.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/kvm32.c
+++ b/target/arm/kvm32.c
@@ -XXX,XX +XXX,XX @@ int kvm_arch_init_vcpu(CPUState *cs)
     }
     cpu->mp_affinity = mpidr & ARM32_AFFINITY_MASK;
 
+    /* Check whether userspace can specify guest syndrome value */
+    kvm_arm_init_serror_injection(cs);
+
     return kvm_arm_init_cpreg_list(cpu);
 }
 
@@ -XXX,XX +XXX,XX @@ int kvm_arch_put_registers(CPUState *cs, int level)
         return ret;
     }
 
+    ret = kvm_put_vcpu_events(cpu);
+    if (ret) {
+        return ret;
+    }
+
     /* Note that we do not call write_cpustate_to_list()
      * here, so we are only writing the tuple list back to
      * KVM. This is safe because nothing can change the
@@ -XXX,XX +XXX,XX @@ int kvm_arch_get_registers(CPUState *cs)
     }
     vfp_set_fpscr(env, fpscr);
 
+    ret = kvm_get_vcpu_events(cpu);
+    if (ret) {
+        return ret;
+    }
+
     if (!write_kvmstate_to_list(cpu)) {
         return EINVAL;
     }
diff --git a/target/arm/kvm64.c b/target/arm/kvm64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/kvm64.c
+++ b/target/arm/kvm64.c
@@ -XXX,XX +XXX,XX @@ int kvm_arch_init_vcpu(CPUState *cs)
 
     kvm_arm_init_debug(cs);
 
+    /* Check whether user space can specify guest syndrome value */
+    kvm_arm_init_serror_injection(cs);
+
     return kvm_arm_init_cpreg_list(cpu);
 }
 
@@ -XXX,XX +XXX,XX @@ int kvm_arch_put_registers(CPUState *cs, int level)
         return ret;
     }
 
+    ret = kvm_put_vcpu_events(cpu);
+    if (ret) {
+        return ret;
+    }
+
     if (!write_list_to_kvmstate(cpu, level)) {
         return EINVAL;
     }
@@ -XXX,XX +XXX,XX @@ int kvm_arch_get_registers(CPUState *cs)
     }
     vfp_set_fpcr(env, fpr);
 
+    ret = kvm_get_vcpu_events(cpu);
+    if (ret) {
+        return ret;
+    }
+
     if (!write_kvmstate_to_list(cpu)) {
         return EINVAL;
     }
diff --git a/target/arm/machine.c b/target/arm/machine.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/machine.c
+++ b/target/arm/machine.c
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_sve = {
 };
 #endif /* AARCH64 */
 
+static bool serror_needed(void *opaque)
+{
+    ARMCPU *cpu = opaque;
+    CPUARMState *env = &cpu->env;
+
+    return env->serror.pending != 0;
+}
+
+static const VMStateDescription vmstate_serror = {
+    .name = "cpu/serror",
+    .version_id = 1,
+    .minimum_version_id = 1,
+    .needed = serror_needed,
+    .fields = (VMStateField[]) {
+        VMSTATE_UINT8(env.serror.pending, ARMCPU),
+        VMSTATE_UINT8(env.serror.has_esr, ARMCPU),
+        VMSTATE_UINT64(env.serror.esr, ARMCPU),
+        VMSTATE_END_OF_LIST()
+    }
+};
+
 static bool m_needed(void *opaque)
 {
     ARMCPU *cpu = opaque;
@@ -XXX,XX +XXX,XX @@ const VMStateDescription vmstate_arm_cpu = {
 #ifdef TARGET_AARCH64
         &vmstate_sve,
 #endif
+        &vmstate_serror,
         NULL
     }
 };
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Create struct ARMISARegisters, to be accessed during translation.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181016223115.24100-2-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h      |  32 ++++----
 hw/intc/armv7m_nvic.c |  12 +--
 target/arm/cpu.c      | 178 +++++++++++++++++++++---------------------
 target/arm/cpu64.c    |  70 ++++++++---------
 target/arm/helper.c   |  28 +++----
 5 files changed, 162 insertions(+), 158 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ struct ARMCPU {
      * ARMv7AR ARM Architecture Reference Manual. A reset_ prefix
      * is used for reset values of non-constant registers; no reset_
      * prefix means a constant register.
+     * Some of these registers are split out into a substructure that
+     * is shared with the translators to control the ISA.
      */
+    struct ARMISARegisters {
+        uint32_t id_isar0;
+        uint32_t id_isar1;
+        uint32_t id_isar2;
+        uint32_t id_isar3;
+        uint32_t id_isar4;
+        uint32_t id_isar5;
+        uint32_t id_isar6;
+        uint32_t mvfr0;
+        uint32_t mvfr1;
+        uint32_t mvfr2;
+        uint64_t id_aa64isar0;
+        uint64_t id_aa64isar1;
+        uint64_t id_aa64pfr0;
+        uint64_t id_aa64pfr1;
+    } isar;
     uint32_t midr;
     uint32_t revidr;
     uint32_t reset_fpsid;
-    uint32_t mvfr0;
-    uint32_t mvfr1;
-    uint32_t mvfr2;
     uint32_t ctr;
     uint32_t reset_sctlr;
     uint32_t id_pfr0;
@@ -XXX,XX +XXX,XX @@ struct ARMCPU {
     uint32_t id_mmfr2;
     uint32_t id_mmfr3;
     uint32_t id_mmfr4;
-    uint32_t id_isar0;
-    uint32_t id_isar1;
-    uint32_t id_isar2;
-    uint32_t id_isar3;
-    uint32_t id_isar4;
-    uint32_t id_isar5;
-    uint32_t id_isar6;
-    uint64_t id_aa64pfr0;
-    uint64_t id_aa64pfr1;
     uint64_t id_aa64dfr0;
     uint64_t id_aa64dfr1;
     uint64_t id_aa64afr0;
     uint64_t id_aa64afr1;
-    uint64_t id_aa64isar0;
-    uint64_t id_aa64isar1;
     uint64_t id_aa64mmfr0;
     uint64_t id_aa64mmfr1;
     uint32_t dbgdidr;
diff --git a/hw/intc/armv7m_nvic.c b/hw/intc/armv7m_nvic.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/intc/armv7m_nvic.c
+++ b/hw/intc/armv7m_nvic.c
@@ -XXX,XX +XXX,XX @@ static uint32_t nvic_readl(NVICState *s, uint32_t offset, MemTxAttrs attrs)
     case 0xd5c: /* MMFR3.  */
         return cpu->id_mmfr3;
     case 0xd60: /* ISAR0.  */
-        return cpu->id_isar0;
+        return cpu->isar.id_isar0;
     case 0xd64: /* ISAR1.  */
-        return cpu->id_isar1;
+        return cpu->isar.id_isar1;
     case 0xd68: /* ISAR2.  */
-        return cpu->id_isar2;
+        return cpu->isar.id_isar2;
     case 0xd6c: /* ISAR3.  */
-        return cpu->id_isar3;
+        return cpu->isar.id_isar3;
     case 0xd70: /* ISAR4.  */
-        return cpu->id_isar4;
+        return cpu->isar.id_isar4;
     case 0xd74: /* ISAR5.  */
-        return cpu->id_isar5;
+        return cpu->isar.id_isar5;
     case 0xd78: /* CLIDR */
         return cpu->clidr;
     case 0xd7c: /* CTR */
diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_reset(CPUState *s)
     g_hash_table_foreach(cpu->cp_regs, cp_reg_check_reset, cpu);
 
     env->vfp.xregs[ARM_VFP_FPSID] = cpu->reset_fpsid;
-    env->vfp.xregs[ARM_VFP_MVFR0] = cpu->mvfr0;
-    env->vfp.xregs[ARM_VFP_MVFR1] = cpu->mvfr1;
-    env->vfp.xregs[ARM_VFP_MVFR2] = cpu->mvfr2;
+    env->vfp.xregs[ARM_VFP_MVFR0] = cpu->isar.mvfr0;
+    env->vfp.xregs[ARM_VFP_MVFR1] = cpu->isar.mvfr1;
+    env->vfp.xregs[ARM_VFP_MVFR2] = cpu->isar.mvfr2;
 
     cpu->power_state = cpu->start_powered_off ? PSCI_OFF : PSCI_ON;
     s->halted = cpu->start_powered_off;
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
          * registers as well. These are id_pfr1[7:4] and id_aa64pfr0[15:12].
          */
         cpu->id_pfr1 &= ~0xf0;
-        cpu->id_aa64pfr0 &= ~0xf000;
+        cpu->isar.id_aa64pfr0 &= ~0xf000;
     }
 
     if (!cpu->has_el2) {
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
          * registers if we don't have EL2. These are id_pfr1[15:12] and
          * id_aa64pfr0_el1[11:8].
          */
-        cpu->id_aa64pfr0 &= ~0xf00;
+        cpu->isar.id_aa64pfr0 &= ~0xf00;
         cpu->id_pfr1 &= ~0xf000;
     }
 
@@ -XXX,XX +XXX,XX @@ static void arm1136_r2_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_CACHE_BLOCK_OPS);
     cpu->midr = 0x4107b362;
     cpu->reset_fpsid = 0x410120b4;
-    cpu->mvfr0 = 0x11111111;
-    cpu->mvfr1 = 0x00000000;
+    cpu->isar.mvfr0 = 0x11111111;
+    cpu->isar.mvfr1 = 0x00000000;
     cpu->ctr = 0x1dd20d2;
     cpu->reset_sctlr = 0x00050078;
     cpu->id_pfr0 = 0x111;
@@ -XXX,XX +XXX,XX @@ static void arm1136_r2_initfn(Object *obj)
     cpu->id_mmfr0 = 0x01130003;
     cpu->id_mmfr1 = 0x10030302;
     cpu->id_mmfr2 = 0x01222110;
-    cpu->id_isar0 = 0x00140011;
-    cpu->id_isar1 = 0x12002111;
-    cpu->id_isar2 = 0x11231111;
-    cpu->id_isar3 = 0x01102131;
-    cpu->id_isar4 = 0x141;
+    cpu->isar.id_isar0 = 0x00140011;
+    cpu->isar.id_isar1 = 0x12002111;
+    cpu->isar.id_isar2 = 0x11231111;
+    cpu->isar.id_isar3 = 0x01102131;
+    cpu->isar.id_isar4 = 0x141;
     cpu->reset_auxcr = 7;
 }
 
@@ -XXX,XX +XXX,XX @@ static void arm1136_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_CACHE_BLOCK_OPS);
     cpu->midr = 0x4117b363;
     cpu->reset_fpsid = 0x410120b4;
-    cpu->mvfr0 = 0x11111111;
-    cpu->mvfr1 = 0x00000000;
+    cpu->isar.mvfr0 = 0x11111111;
+    cpu->isar.mvfr1 = 0x00000000;
     cpu->ctr = 0x1dd20d2;
     cpu->reset_sctlr = 0x00050078;
     cpu->id_pfr0 = 0x111;
@@ -XXX,XX +XXX,XX @@ static void arm1136_initfn(Object *obj)
     cpu->id_mmfr0 = 0x01130003;
     cpu->id_mmfr1 = 0x10030302;
     cpu->id_mmfr2 = 0x01222110;
-    cpu->id_isar0 = 0x00140011;
-    cpu->id_isar1 = 0x12002111;
-    cpu->id_isar2 = 0x11231111;
-    cpu->id_isar3 = 0x01102131;
-    cpu->id_isar4 = 0x141;
+    cpu->isar.id_isar0 = 0x00140011;
+    cpu->isar.id_isar1 = 0x12002111;
+    cpu->isar.id_isar2 = 0x11231111;
+    cpu->isar.id_isar3 = 0x01102131;
+    cpu->isar.id_isar4 = 0x141;
     cpu->reset_auxcr = 7;
 }
 
@@ -XXX,XX +XXX,XX @@ static void arm1176_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_EL3);
     cpu->midr = 0x410fb767;
     cpu->reset_fpsid = 0x410120b5;
-    cpu->mvfr0 = 0x11111111;
-    cpu->mvfr1 = 0x00000000;
+    cpu->isar.mvfr0 = 0x11111111;
+    cpu->isar.mvfr1 = 0x00000000;
     cpu->ctr = 0x1dd20d2;
     cpu->reset_sctlr = 0x00050078;
     cpu->id_pfr0 = 0x111;
@@ -XXX,XX +XXX,XX @@ static void arm1176_initfn(Object *obj)
     cpu->id_mmfr0 = 0x01130003;
     cpu->id_mmfr1 = 0x10030302;
     cpu->id_mmfr2 = 0x01222100;
-    cpu->id_isar0 = 0x0140011;
-    cpu->id_isar1 = 0x12002111;
-    cpu->id_isar2 = 0x11231121;
-    cpu->id_isar3 = 0x01102131;
-    cpu->id_isar4 = 0x01141;
+    cpu->isar.id_isar0 = 0x0140011;
+    cpu->isar.id_isar1 = 0x12002111;
+    cpu->isar.id_isar2 = 0x11231121;
+    cpu->isar.id_isar3 = 0x01102131;
+    cpu->isar.id_isar4 = 0x01141;
     cpu->reset_auxcr = 7;
 }
 
@@ -XXX,XX +XXX,XX @@ static void arm11mpcore_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
     cpu->midr = 0x410fb022;
     cpu->reset_fpsid = 0x410120b4;
-    cpu->mvfr0 = 0x11111111;
-    cpu->mvfr1 = 0x00000000;
+    cpu->isar.mvfr0 = 0x11111111;
+    cpu->isar.mvfr1 = 0x00000000;
     cpu->ctr = 0x1d192992; /* 32K icache 32K dcache */
     cpu->id_pfr0 = 0x111;
     cpu->id_pfr1 = 0x1;
@@ -XXX,XX +XXX,XX @@ static void arm11mpcore_initfn(Object *obj)
     cpu->id_mmfr0 = 0x01100103;
     cpu->id_mmfr1 = 0x10020302;
     cpu->id_mmfr2 = 0x01222000;
-    cpu->id_isar0 = 0x00100011;
-    cpu->id_isar1 = 0x12002111;
-    cpu->id_isar2 = 0x11221011;
-    cpu->id_isar3 = 0x01102131;
-    cpu->id_isar4 = 0x141;
+    cpu->isar.id_isar0 = 0x00100011;
+    cpu->isar.id_isar1 = 0x12002111;
+    cpu->isar.id_isar2 = 0x11221011;
+    cpu->isar.id_isar3 = 0x01102131;
+    cpu->isar.id_isar4 = 0x141;
     cpu->reset_auxcr = 1;
 }
 
@@ -XXX,XX +XXX,XX @@ static void cortex_m3_initfn(Object *obj)
     cpu->id_mmfr1 = 0x00000000;
     cpu->id_mmfr2 = 0x00000000;
     cpu->id_mmfr3 = 0x00000000;
-    cpu->id_isar0 = 0x01141110;
-    cpu->id_isar1 = 0x02111000;
-    cpu->id_isar2 = 0x21112231;
-    cpu->id_isar3 = 0x01111110;
-    cpu->id_isar4 = 0x01310102;
-    cpu->id_isar5 = 0x00000000;
-    cpu->id_isar6 = 0x00000000;
+    cpu->isar.id_isar0 = 0x01141110;
+    cpu->isar.id_isar1 = 0x02111000;
+    cpu->isar.id_isar2 = 0x21112231;
+    cpu->isar.id_isar3 = 0x01111110;
+    cpu->isar.id_isar4 = 0x01310102;
+    cpu->isar.id_isar5 = 0x00000000;
+    cpu->isar.id_isar6 = 0x00000000;
 }
 
 static void cortex_m4_initfn(Object *obj)
@@ -XXX,XX +XXX,XX @@ static void cortex_m4_initfn(Object *obj)
     cpu->id_mmfr1 = 0x00000000;
     cpu->id_mmfr2 = 0x00000000;
     cpu->id_mmfr3 = 0x00000000;
-    cpu->id_isar0 = 0x01141110;
-    cpu->id_isar1 = 0x02111000;
-    cpu->id_isar2 = 0x21112231;
-    cpu->id_isar3 = 0x01111110;
-    cpu->id_isar4 = 0x01310102;
-    cpu->id_isar5 = 0x00000000;
-    cpu->id_isar6 = 0x00000000;
+    cpu->isar.id_isar0 = 0x01141110;
+    cpu->isar.id_isar1 = 0x02111000;
+    cpu->isar.id_isar2 = 0x21112231;
+    cpu->isar.id_isar3 = 0x01111110;
+    cpu->isar.id_isar4 = 0x01310102;
+    cpu->isar.id_isar5 = 0x00000000;
+    cpu->isar.id_isar6 = 0x00000000;
 }
 
 static void cortex_m33_initfn(Object *obj)
@@ -XXX,XX +XXX,XX @@ static void cortex_m33_initfn(Object *obj)
     cpu->id_mmfr1 = 0x00000000;
     cpu->id_mmfr2 = 0x01000000;
     cpu->id_mmfr3 = 0x00000000;
-    cpu->id_isar0 = 0x01101110;
-    cpu->id_isar1 = 0x02212000;
-    cpu->id_isar2 = 0x20232232;
-    cpu->id_isar3 = 0x01111131;
-    cpu->id_isar4 = 0x01310132;
-    cpu->id_isar5 = 0x00000000;
-    cpu->id_isar6 = 0x00000000;
+    cpu->isar.id_isar0 = 0x01101110;
+    cpu->isar.id_isar1 = 0x02212000;
+    cpu->isar.id_isar2 = 0x20232232;
+    cpu->isar.id_isar3 = 0x01111131;
+    cpu->isar.id_isar4 = 0x01310132;
+    cpu->isar.id_isar5 = 0x00000000;
+    cpu->isar.id_isar6 = 0x00000000;
     cpu->clidr = 0x00000000;
     cpu->ctr = 0x8000c000;
 }
@@ -XXX,XX +XXX,XX @@ static void cortex_r5_initfn(Object *obj)
     cpu->id_mmfr1 = 0x00000000;
     cpu->id_mmfr2 = 0x01200000;
     cpu->id_mmfr3 = 0x0211;
-    cpu->id_isar0 = 0x02101111;
-    cpu->id_isar1 = 0x13112111;
-    cpu->id_isar2 = 0x21232141;
-    cpu->id_isar3 = 0x01112131;
-    cpu->id_isar4 = 0x0010142;
-    cpu->id_isar5 = 0x0;
-    cpu->id_isar6 = 0x0;
+    cpu->isar.id_isar0 = 0x02101111;
+    cpu->isar.id_isar1 = 0x13112111;
+    cpu->isar.id_isar2 = 0x21232141;
+    cpu->isar.id_isar3 = 0x01112131;
+    cpu->isar.id_isar4 = 0x0010142;
+    cpu->isar.id_isar5 = 0x0;
+    cpu->isar.id_isar6 = 0x0;
     cpu->mp_is_up = true;
     cpu->pmsav7_dregion = 16;
     define_arm_cp_regs(cpu, cortexr5_cp_reginfo);
@@ -XXX,XX +XXX,XX @@ static void cortex_a8_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_EL3);
     cpu->midr = 0x410fc080;
     cpu->reset_fpsid = 0x410330c0;
-    cpu->mvfr0 = 0x11110222;
-    cpu->mvfr1 = 0x00011111;
+    cpu->isar.mvfr0 = 0x11110222;
+    cpu->isar.mvfr1 = 0x00011111;
     cpu->ctr = 0x82048004;
     cpu->reset_sctlr = 0x00c50078;
     cpu->id_pfr0 = 0x1031;
@@ -XXX,XX +XXX,XX @@ static void cortex_a8_initfn(Object *obj)
     cpu->id_mmfr1 = 0x20000000;
     cpu->id_mmfr2 = 0x01202000;
     cpu->id_mmfr3 = 0x11;
-    cpu->id_isar0 = 0x00101111;
-    cpu->id_isar1 = 0x12112111;
-    cpu->id_isar2 = 0x21232031;
-    cpu->id_isar3 = 0x11112131;
-    cpu->id_isar4 = 0x00111142;
+    cpu->isar.id_isar0 = 0x00101111;
+    cpu->isar.id_isar1 = 0x12112111;
+    cpu->isar.id_isar2 = 0x21232031;
+    cpu->isar.id_isar3 = 0x11112131;
+    cpu->isar.id_isar4 = 0x00111142;
     cpu->dbgdidr = 0x15141000;
     cpu->clidr = (1 << 27) | (2 << 24) | 3;
     cpu->ccsidr[0] = 0xe007e01a; /* 16k L1 dcache. */
@@ -XXX,XX +XXX,XX @@ static void cortex_a9_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_CBAR);
     cpu->midr = 0x410fc090;
     cpu->reset_fpsid = 0x41033090;
-    cpu->mvfr0 = 0x11110222;
-    cpu->mvfr1 = 0x01111111;
+    cpu->isar.mvfr0 = 0x11110222;
+    cpu->isar.mvfr1 = 0x01111111;
     cpu->ctr = 0x80038003;
     cpu->reset_sctlr = 0x00c50078;
     cpu->id_pfr0 = 0x1031;
@@ -XXX,XX +XXX,XX @@ static void cortex_a9_initfn(Object *obj)
     cpu->id_mmfr1 = 0x20000000;
     cpu->id_mmfr2 = 0x01230000;
     cpu->id_mmfr3 = 0x00002111;
-    cpu->id_isar0 = 0x00101111;
-    cpu->id_isar1 = 0x13112111;
-    cpu->id_isar2 = 0x21232041;
-    cpu->id_isar3 = 0x11112131;
-    cpu->id_isar4 = 0x00111142;
+    cpu->isar.id_isar0 = 0x00101111;
+    cpu->isar.id_isar1 = 0x13112111;
+    cpu->isar.id_isar2 = 0x21232041;
+    cpu->isar.id_isar3 = 0x11112131;
+    cpu->isar.id_isar4 = 0x00111142;
     cpu->dbgdidr = 0x35141000;
     cpu->clidr = (1 << 27) | (1 << 24) | 3;
     cpu->ccsidr[0] = 0xe00fe019; /* 16k L1 dcache. */
@@ -XXX,XX +XXX,XX @@ static void cortex_a7_initfn(Object *obj)
     cpu->kvm_target = QEMU_KVM_ARM_TARGET_CORTEX_A7;
     cpu->midr = 0x410fc075;
     cpu->reset_fpsid = 0x41023075;
-    cpu->mvfr0 = 0x10110222;
-    cpu->mvfr1 = 0x11111111;
+    cpu->isar.mvfr0 = 0x10110222;
+    cpu->isar.mvfr1 = 0x11111111;
     cpu->ctr = 0x84448003;
     cpu->reset_sctlr = 0x00c50078;
     cpu->id_pfr0 = 0x00001131;
@@ -XXX,XX +XXX,XX @@ static void cortex_a7_initfn(Object *obj)
     /* a7_mpcore_r0p5_trm, page 4-4 gives 0x01101110; but
      * table 4-41 gives 0x02101110, which includes the arm div insns.
      */
-    cpu->id_isar0 = 0x02101110;
-    cpu->id_isar1 = 0x13112111;
-    cpu->id_isar2 = 0x21232041;
-    cpu->id_isar3 = 0x11112131;
-    cpu->id_isar4 = 0x10011142;
+    cpu->isar.id_isar0 = 0x02101110;
+    cpu->isar.id_isar1 = 0x13112111;
+    cpu->isar.id_isar2 = 0x21232041;
+    cpu->isar.id_isar3 = 0x11112131;
+    cpu->isar.id_isar4 = 0x10011142;
     cpu->dbgdidr = 0x3515f005;
     cpu->clidr = 0x0a200023;
     cpu->ccsidr[0] = 0x701fe00a; /* 32K L1 dcache */
@@ -XXX,XX +XXX,XX @@ static void cortex_a15_initfn(Object *obj)
     cpu->kvm_target = QEMU_KVM_ARM_TARGET_CORTEX_A15;
     cpu->midr = 0x412fc0f1;
     cpu->reset_fpsid = 0x410430f0;
-    cpu->mvfr0 = 0x10110222;
-    cpu->mvfr1 = 0x11111111;
+    cpu->isar.mvfr0 = 0x10110222;
+    cpu->isar.mvfr1 = 0x11111111;
     cpu->ctr = 0x8444c004;
     cpu->reset_sctlr = 0x00c50078;
     cpu->id_pfr0 = 0x00001131;
@@ -XXX,XX +XXX,XX @@ static void cortex_a15_initfn(Object *obj)
     cpu->id_mmfr1 = 0x20000000;
     cpu->id_mmfr2 = 0x01240000;
     cpu->id_mmfr3 = 0x02102211;
-    cpu->id_isar0 = 0x02101110;
-    cpu->id_isar1 = 0x13112111;
-    cpu->id_isar2 = 0x21232041;
-    cpu->id_isar3 = 0x11112131;
-    cpu->id_isar4 = 0x10011142;
+    cpu->isar.id_isar0 = 0x02101110;
+    cpu->isar.id_isar1 = 0x13112111;
+    cpu->isar.id_isar2 = 0x21232041;
+    cpu->isar.id_isar3 = 0x11112131;
+    cpu->isar.id_isar4 = 0x10011142;
     cpu->dbgdidr = 0x3515f021;
     cpu->clidr = 0x0a200023;
     cpu->ccsidr[0] = 0x701fe00a; /* 32K L1 dcache */
diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu64.c
+++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_a57_initfn(Object *obj)
     cpu->midr = 0x411fd070;
     cpu->revidr = 0x00000000;
     cpu->reset_fpsid = 0x41034070;
-    cpu->mvfr0 = 0x10110222;
-    cpu->mvfr1 = 0x12111111;
-    cpu->mvfr2 = 0x00000043;
+    cpu->isar.mvfr0 = 0x10110222;
+    cpu->isar.mvfr1 = 0x12111111;
+    cpu->isar.mvfr2 = 0x00000043;
     cpu->ctr = 0x8444c004;
     cpu->reset_sctlr = 0x00c50838;
     cpu->id_pfr0 = 0x00000131;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a57_initfn(Object *obj)
     cpu->id_mmfr1 = 0x40000000;
     cpu->id_mmfr2 = 0x01260000;
     cpu->id_mmfr3 = 0x02102211;
-    cpu->id_isar0 = 0x02101110;
-    cpu->id_isar1 = 0x13112111;
-    cpu->id_isar2 = 0x21232042;
-    cpu->id_isar3 = 0x01112131;
-    cpu->id_isar4 = 0x00011142;
-    cpu->id_isar5 = 0x00011121;
-    cpu->id_isar6 = 0;
-    cpu->id_aa64pfr0 = 0x00002222;
+    cpu->isar.id_isar0 = 0x02101110;
+    cpu->isar.id_isar1 = 0x13112111;
+    cpu->isar.id_isar2 = 0x21232042;
+    cpu->isar.id_isar3 = 0x01112131;
+    cpu->isar.id_isar4 = 0x00011142;
+    cpu->isar.id_isar5 = 0x00011121;
+    cpu->isar.id_isar6 = 0;
+    cpu->isar.id_aa64pfr0 = 0x00002222;
     cpu->id_aa64dfr0 = 0x10305106;
     cpu->pmceid0 = 0x00000000;
     cpu->pmceid1 = 0x00000000;
-    cpu->id_aa64isar0 = 0x00011120;
+    cpu->isar.id_aa64isar0 = 0x00011120;
     cpu->id_aa64mmfr0 = 0x00001124;
     cpu->dbgdidr = 0x3516d000;
     cpu->clidr = 0x0a200023;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a53_initfn(Object *obj)
     cpu->midr = 0x410fd034;
     cpu->revidr = 0x00000000;
     cpu->reset_fpsid = 0x41034070;
-    cpu->mvfr0 = 0x10110222;
-    cpu->mvfr1 = 0x12111111;
-    cpu->mvfr2 = 0x00000043;
+    cpu->isar.mvfr0 = 0x10110222;
+    cpu->isar.mvfr1 = 0x12111111;
+    cpu->isar.mvfr2 = 0x00000043;
     cpu->ctr = 0x84448004; /* L1Ip = VIPT */
     cpu->reset_sctlr = 0x00c50838;
     cpu->id_pfr0 = 0x00000131;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a53_initfn(Object *obj)
     cpu->id_mmfr1 = 0x40000000;
     cpu->id_mmfr2 = 0x01260000;
     cpu->id_mmfr3 = 0x02102211;
-    cpu->id_isar0 = 0x02101110;
-    cpu->id_isar1 = 0x13112111;
-    cpu->id_isar2 = 0x21232042;
-    cpu->id_isar3 = 0x01112131;
-    cpu->id_isar4 = 0x00011142;
-    cpu->id_isar5 = 0x00011121;
-    cpu->id_isar6 = 0;
-    cpu->id_aa64pfr0 = 0x00002222;
+    cpu->isar.id_isar0 = 0x02101110;
+    cpu->isar.id_isar1 = 0x13112111;
+    cpu->isar.id_isar2 = 0x21232042;
+    cpu->isar.id_isar3 = 0x01112131;
+    cpu->isar.id_isar4 = 0x00011142;
+    cpu->isar.id_isar5 = 0x00011121;
+    cpu->isar.id_isar6 = 0;
+    cpu->isar.id_aa64pfr0 = 0x00002222;
     cpu->id_aa64dfr0 = 0x10305106;
-    cpu->id_aa64isar0 = 0x00011120;
+    cpu->isar.id_aa64isar0 = 0x00011120;
     cpu->id_aa64mmfr0 = 0x00001122; /* 40 bit physical addr */
     cpu->dbgdidr = 0x3516d000;
     cpu->clidr = 0x0a200023;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a72_initfn(Object *obj)
     cpu->midr = 0x410fd083;
     cpu->revidr = 0x00000000;
     cpu->reset_fpsid = 0x41034080;
-    cpu->mvfr0 = 0x10110222;
-    cpu->mvfr1 = 0x12111111;
-    cpu->mvfr2 = 0x00000043;
+    cpu->isar.mvfr0 = 0x10110222;
+    cpu->isar.mvfr1 = 0x12111111;
+    cpu->isar.mvfr2 = 0x00000043;
     cpu->ctr = 0x8444c004;
     cpu->reset_sctlr = 0x00c50838;
     cpu->id_pfr0 = 0x00000131;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a72_initfn(Object *obj)
     cpu->id_mmfr1 = 0x40000000;
     cpu->id_mmfr2 = 0x01260000;
     cpu->id_mmfr3 = 0x02102211;
-    cpu->id_isar0 = 0x02101110;
-    cpu->id_isar1 = 0x13112111;
-    cpu->id_isar2 = 0x21232042;
-    cpu->id_isar3 = 0x01112131;
-    cpu->id_isar4 = 0x00011142;
-    cpu->id_isar5 = 0x00011121;
-    cpu->id_aa64pfr0 = 0x00002222;
+    cpu->isar.id_isar0 = 0x02101110;
+    cpu->isar.id_isar1 = 0x13112111;
+    cpu->isar.id_isar2 = 0x21232042;
+    cpu->isar.id_isar3 = 0x01112131;
+    cpu->isar.id_isar4 = 0x00011142;
+    cpu->isar.id_isar5 = 0x00011121;
+    cpu->isar.id_aa64pfr0 = 0x00002222;
     cpu->id_aa64dfr0 = 0x10305106;
     cpu->pmceid0 = 0x00000000;
     cpu->pmceid1 = 0x00000000;
-    cpu->id_aa64isar0 = 0x00011120;
+    cpu->isar.id_aa64isar0 = 0x00011120;
     cpu->id_aa64mmfr0 = 0x00001124;
     cpu->dbgdidr = 0x3516d000;
     cpu->clidr = 0x0a200023;
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static uint64_t id_pfr1_read(CPUARMState *env, const ARMCPRegInfo *ri)
 static uint64_t id_aa64pfr0_read(CPUARMState *env, const ARMCPRegInfo *ri)
 {
     ARMCPU *cpu = arm_env_get_cpu(env);
-    uint64_t pfr0 = cpu->id_aa64pfr0;
+    uint64_t pfr0 = cpu->isar.id_aa64pfr0;
 
     if (env->gicv3state) {
         pfr0 |= 1 << 24;
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
             { .name = "ID_ISAR0", .state = ARM_CP_STATE_BOTH,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 0,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_isar0 },
+              .resetvalue = cpu->isar.id_isar0 },
             { .name = "ID_ISAR1", .state = ARM_CP_STATE_BOTH,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 1,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_isar1 },
+              .resetvalue = cpu->isar.id_isar1 },
             { .name = "ID_ISAR2", .state = ARM_CP_STATE_BOTH,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 2,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_isar2 },
+              .resetvalue = cpu->isar.id_isar2 },
             { .name = "ID_ISAR3", .state = ARM_CP_STATE_BOTH,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 3,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_isar3 },
+              .resetvalue = cpu->isar.id_isar3 },
             { .name = "ID_ISAR4", .state = ARM_CP_STATE_BOTH,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 4,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_isar4 },
+              .resetvalue = cpu->isar.id_isar4 },
             { .name = "ID_ISAR5", .state = ARM_CP_STATE_BOTH,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 5,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_isar5 },
+              .resetvalue = cpu->isar.id_isar5 },
             { .name = "ID_MMFR4", .state = ARM_CP_STATE_BOTH,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 6,
               .access = PL1_R, .type = ARM_CP_CONST,
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
             { .name = "ID_ISAR6", .state = ARM_CP_STATE_BOTH,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 7,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_isar6 },
+              .resetvalue = cpu->isar.id_isar6 },
             REGINFO_SENTINEL
         };
         define_arm_cp_regs(cpu, v6_idregs);
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
             { .name = "ID_AA64PFR1_EL1", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 4, .opc2 = 1,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_aa64pfr1},
+              .resetvalue = cpu->isar.id_aa64pfr1},
             { .name = "ID_AA64PFR2_EL1_RESERVED", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 4, .opc2 = 2,
               .access = PL1_R, .type = ARM_CP_CONST,
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
             { .name = "ID_AA64ISAR0_EL1", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 6, .opc2 = 0,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_aa64isar0 },
+              .resetvalue = cpu->isar.id_aa64isar0 },
             { .name = "ID_AA64ISAR1_EL1", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 6, .opc2 = 1,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->id_aa64isar1 },
+              .resetvalue = cpu->isar.id_aa64isar1 },
             { .name = "ID_AA64ISAR2_EL1_RESERVED", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 6, .opc2 = 2,
               .access = PL1_R, .type = ARM_CP_CONST,
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
             { .name = "MVFR0_EL1", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 3, .opc2 = 0,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->mvfr0 },
+              .resetvalue = cpu->isar.mvfr0 },
             { .name = "MVFR1_EL1", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 3, .opc2 = 1,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->mvfr1 },
+              .resetvalue = cpu->isar.mvfr1 },
             { .name = "MVFR2_EL1", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 3, .opc2 = 2,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = cpu->mvfr2 },
+              .resetvalue = cpu->isar.mvfr2 },
             { .name = "MVFR3_EL1_RESERVED", .state = ARM_CP_STATE_AA64,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 3, .opc2 = 3,
               .access = PL1_R, .type = ARM_CP_CONST,
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Instantiating mps2-an505 (cortex-m33) will fail make check when
V7VE asserts that ID_ISAR0.Divide includes ARM division.  It is
also wrong to include ARM_FEATURE_LPAE.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181016223115.24100-3-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.c | 6 +++++-
 1 file changed, 5 insertions(+), 1 deletion(-)

diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
 
     /* Some features automatically imply others: */
     if (arm_feature(env, ARM_FEATURE_V8)) {
-        set_feature(env, ARM_FEATURE_V7VE);
+        if (arm_feature(env, ARM_FEATURE_M)) {
+            set_feature(env, ARM_FEATURE_V7);
+        } else {
+            set_feature(env, ARM_FEATURE_V7VE);
+        }
     }
     if (arm_feature(env, ARM_FEATURE_V7VE)) {
         /* v7 Virtualization Extensions. In real hardware this implies
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Most of the v8 extensions are self-contained within the ISAR
registers and are not implied by other feature bits, which
makes them the easiest to convert.

Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181016223115.24100-4-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h           | 131 +++++++++++++++++++++++++++++++++----
 target/arm/translate.h     |   7 ++
 linux-user/elfload.c       |  46 ++++++++-----
 target/arm/cpu.c           |  27 +++++---
 target/arm/cpu64.c         |  57 +++++++++-------
 target/arm/translate-a64.c | 101 ++++++++++++++--------------
 target/arm/translate.c     |  36 +++++-----
 7 files changed, 273 insertions(+), 132 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ typedef enum ARMPSCIState {
     PSCI_ON_PENDING = 2
 } ARMPSCIState;
 
+typedef struct ARMISARegisters ARMISARegisters;
+
 /**
  * ARMCPU:
  * @env: #CPUARMState
@@ -XXX,XX +XXX,XX @@ enum arm_features {
     ARM_FEATURE_LPAE, /* has Large Physical Address Extension */
     ARM_FEATURE_V8,
     ARM_FEATURE_AARCH64, /* supports 64 bit mode */
-    ARM_FEATURE_V8_AES, /* implements AES part of v8 Crypto Extensions */
     ARM_FEATURE_CBAR, /* has cp15 CBAR */
     ARM_FEATURE_CRC, /* ARMv8 CRC instructions */
     ARM_FEATURE_CBAR_RO, /* has cp15 CBAR and it is read-only */
     ARM_FEATURE_EL2, /* has EL2 Virtualization support */
     ARM_FEATURE_EL3, /* has EL3 Secure monitor support */
-    ARM_FEATURE_V8_SHA1, /* implements SHA1 part of v8 Crypto Extensions */
-    ARM_FEATURE_V8_SHA256, /* implements SHA256 part of v8 Crypto Extensions */
-    ARM_FEATURE_V8_PMULL, /* implements PMULL part of v8 Crypto Extensions */
     ARM_FEATURE_THUMB_DSP, /* DSP insns supported in the Thumb encodings */
     ARM_FEATURE_PMU, /* has PMU support */
     ARM_FEATURE_VBAR, /* has cp15 VBAR */
     ARM_FEATURE_M_SECURITY, /* M profile Security Extension */
     ARM_FEATURE_JAZELLE, /* has (trivial) Jazelle implementation */
     ARM_FEATURE_SVE, /* has Scalable Vector Extension */
-    ARM_FEATURE_V8_SHA512, /* implements SHA512 part of v8 Crypto Extensions */
-    ARM_FEATURE_V8_SHA3, /* implements SHA3 part of v8 Crypto Extensions */
-    ARM_FEATURE_V8_SM3, /* implements SM3 part of v8 Crypto Extensions */
-    ARM_FEATURE_V8_SM4, /* implements SM4 part of v8 Crypto Extensions */
-    ARM_FEATURE_V8_ATOMICS, /* ARMv8.1-Atomics feature */
-    ARM_FEATURE_V8_RDM, /* implements v8.1 simd round multiply */
-    ARM_FEATURE_V8_DOTPROD, /* implements v8.2 simd dot product */
     ARM_FEATURE_V8_FP16, /* implements v8.2 half-precision float */
-    ARM_FEATURE_V8_FCMA, /* has complex number part of v8.3 extensions.  */
     ARM_FEATURE_M_MAIN, /* M profile Main Extension */
 };
 
@@ -XXX,XX +XXX,XX @@ static inline uint64_t *aa64_vfp_qreg(CPUARMState *env, unsigned regno)
 /* Shared between translate-sve.c and sve_helper.c.  */
 extern const uint64_t pred_esz_masks[4];
 
+/*
+ * 32-bit feature tests via id registers.
+ */
+static inline bool isar_feature_aa32_aes(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) != 0;
+}
+
+static inline bool isar_feature_aa32_pmull(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) > 1;
+}
+
+static inline bool isar_feature_aa32_sha1(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar5, ID_ISAR5, SHA1) != 0;
+}
+
+static inline bool isar_feature_aa32_sha2(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar5, ID_ISAR5, SHA2) != 0;
+}
+
+static inline bool isar_feature_aa32_crc32(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar5, ID_ISAR5, CRC32) != 0;
+}
+
+static inline bool isar_feature_aa32_rdm(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar5, ID_ISAR5, RDM) != 0;
+}
+
+static inline bool isar_feature_aa32_vcma(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar5, ID_ISAR5, VCMA) != 0;
+}
+
+static inline bool isar_feature_aa32_dp(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar6, ID_ISAR6, DP) != 0;
+}
+
+/*
+ * 64-bit feature tests via id registers.
+ */
+static inline bool isar_feature_aa64_aes(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, AES) != 0;
+}
+
+static inline bool isar_feature_aa64_pmull(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, AES) > 1;
+}
+
+static inline bool isar_feature_aa64_sha1(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SHA1) != 0;
+}
+
+static inline bool isar_feature_aa64_sha256(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SHA2) != 0;
+}
+
+static inline bool isar_feature_aa64_sha512(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SHA2) > 1;
+}
+
+static inline bool isar_feature_aa64_crc32(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, CRC32) != 0;
+}
+
+static inline bool isar_feature_aa64_atomics(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, ATOMIC) != 0;
+}
+
+static inline bool isar_feature_aa64_rdm(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, RDM) != 0;
+}
+
+static inline bool isar_feature_aa64_sha3(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SHA3) != 0;
+}
+
+static inline bool isar_feature_aa64_sm3(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SM3) != 0;
+}
+
+static inline bool isar_feature_aa64_sm4(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, SM4) != 0;
+}
+
+static inline bool isar_feature_aa64_dp(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar0, ID_AA64ISAR0, DP) != 0;
+}
+
+static inline bool isar_feature_aa64_fcma(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64isar1, ID_AA64ISAR1, FCMA) != 0;
+}
+
+/*
+ * Forward to the above feature tests given an ARMCPU pointer.
+ */
+#define cpu_isar_feature(name, cpu) \
+    ({ ARMCPU *cpu_ = (cpu); isar_feature_##name(&cpu_->isar); })
+
 #endif
diff --git a/target/arm/translate.h b/target/arm/translate.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.h
+++ b/target/arm/translate.h
@@ -XXX,XX +XXX,XX @@
 /* internal defines */
 typedef struct DisasContext {
     DisasContextBase base;
+    const ARMISARegisters *isar;
 
     target_ulong pc;
     target_ulong page_start;
@@ -XXX,XX +XXX,XX @@ static inline TCGv_i32 get_ahp_flag(void)
     return ret;
 }
 
+/*
+ * Forward to the isar_feature_* tests given a DisasContext pointer.
+ */
+#define dc_isar_feature(name, ctx) \
+    ({ DisasContext *ctx_ = (ctx); isar_feature_##name(ctx_->isar); })
+
 #endif /* TARGET_ARM_TRANSLATE_H */
diff --git a/linux-user/elfload.c b/linux-user/elfload.c
index XXXXXXX..XXXXXXX 100644
--- a/linux-user/elfload.c
+++ b/linux-user/elfload.c
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
     /* probe for the extra features */
 #define GET_FEATURE(feat, hwcap) \
     do { if (arm_feature(&cpu->env, feat)) { hwcaps |= hwcap; } } while (0)
+
+#define GET_FEATURE_ID(feat, hwcap) \
+    do { if (cpu_isar_feature(feat, cpu)) { hwcaps |= hwcap; } } while (0)
+
     /* EDSP is in v5TE and above, but all our v5 CPUs are v5TE */
     GET_FEATURE(ARM_FEATURE_V5, ARM_HWCAP_ARM_EDSP);
     GET_FEATURE(ARM_FEATURE_VFP, ARM_HWCAP_ARM_VFP);
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap2(void)
     ARMCPU *cpu = ARM_CPU(thread_cpu);
     uint32_t hwcaps = 0;
 
-    GET_FEATURE(ARM_FEATURE_V8_AES, ARM_HWCAP2_ARM_AES);
-    GET_FEATURE(ARM_FEATURE_V8_PMULL, ARM_HWCAP2_ARM_PMULL);
-    GET_FEATURE(ARM_FEATURE_V8_SHA1, ARM_HWCAP2_ARM_SHA1);
-    GET_FEATURE(ARM_FEATURE_V8_SHA256, ARM_HWCAP2_ARM_SHA2);
-    GET_FEATURE(ARM_FEATURE_CRC, ARM_HWCAP2_ARM_CRC32);
+    GET_FEATURE_ID(aa32_aes, ARM_HWCAP2_ARM_AES);
+    GET_FEATURE_ID(aa32_pmull, ARM_HWCAP2_ARM_PMULL);
+    GET_FEATURE_ID(aa32_sha1, ARM_HWCAP2_ARM_SHA1);
+    GET_FEATURE_ID(aa32_sha2, ARM_HWCAP2_ARM_SHA2);
+    GET_FEATURE_ID(aa32_crc32, ARM_HWCAP2_ARM_CRC32);
     return hwcaps;
 }
 
 #undef GET_FEATURE
+#undef GET_FEATURE_ID
 
 #else
 /* 64 bit ARM definitions */
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
     /* probe for the extra features */
 #define GET_FEATURE(feat, hwcap) \
     do { if (arm_feature(&cpu->env, feat)) { hwcaps |= hwcap; } } while (0)
-    GET_FEATURE(ARM_FEATURE_V8_AES, ARM_HWCAP_A64_AES);
-    GET_FEATURE(ARM_FEATURE_V8_PMULL, ARM_HWCAP_A64_PMULL);
-    GET_FEATURE(ARM_FEATURE_V8_SHA1, ARM_HWCAP_A64_SHA1);
-    GET_FEATURE(ARM_FEATURE_V8_SHA256, ARM_HWCAP_A64_SHA2);
-    GET_FEATURE(ARM_FEATURE_CRC, ARM_HWCAP_A64_CRC32);
-    GET_FEATURE(ARM_FEATURE_V8_SHA3, ARM_HWCAP_A64_SHA3);
-    GET_FEATURE(ARM_FEATURE_V8_SM3, ARM_HWCAP_A64_SM3);
-    GET_FEATURE(ARM_FEATURE_V8_SM4, ARM_HWCAP_A64_SM4);
-    GET_FEATURE(ARM_FEATURE_V8_SHA512, ARM_HWCAP_A64_SHA512);
+#define GET_FEATURE_ID(feat, hwcap) \
+    do { if (cpu_isar_feature(feat, cpu)) { hwcaps |= hwcap; } } while (0)
+
+    GET_FEATURE_ID(aa64_aes, ARM_HWCAP_A64_AES);
+    GET_FEATURE_ID(aa64_pmull, ARM_HWCAP_A64_PMULL);
+    GET_FEATURE_ID(aa64_sha1, ARM_HWCAP_A64_SHA1);
+    GET_FEATURE_ID(aa64_sha256, ARM_HWCAP_A64_SHA2);
+    GET_FEATURE_ID(aa64_sha512, ARM_HWCAP_A64_SHA512);
+    GET_FEATURE_ID(aa64_crc32, ARM_HWCAP_A64_CRC32);
+    GET_FEATURE_ID(aa64_sha3, ARM_HWCAP_A64_SHA3);
+    GET_FEATURE_ID(aa64_sm3, ARM_HWCAP_A64_SM3);
+    GET_FEATURE_ID(aa64_sm4, ARM_HWCAP_A64_SM4);
     GET_FEATURE(ARM_FEATURE_V8_FP16,
                 ARM_HWCAP_A64_FPHP | ARM_HWCAP_A64_ASIMDHP);
-    GET_FEATURE(ARM_FEATURE_V8_ATOMICS, ARM_HWCAP_A64_ATOMICS);
-    GET_FEATURE(ARM_FEATURE_V8_RDM, ARM_HWCAP_A64_ASIMDRDM);
-    GET_FEATURE(ARM_FEATURE_V8_DOTPROD, ARM_HWCAP_A64_ASIMDDP);
-    GET_FEATURE(ARM_FEATURE_V8_FCMA, ARM_HWCAP_A64_FCMA);
+    GET_FEATURE_ID(aa64_atomics, ARM_HWCAP_A64_ATOMICS);
+    GET_FEATURE_ID(aa64_rdm, ARM_HWCAP_A64_ASIMDRDM);
+    GET_FEATURE_ID(aa64_dp, ARM_HWCAP_A64_ASIMDDP);
+    GET_FEATURE_ID(aa64_fcma, ARM_HWCAP_A64_FCMA);
     GET_FEATURE(ARM_FEATURE_SVE, ARM_HWCAP_A64_SVE);
+
 #undef GET_FEATURE
+#undef GET_FEATURE_ID
 
     return hwcaps;
 }
diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_max_initfn(Object *obj)
         cortex_a15_initfn(obj);
 #ifdef CONFIG_USER_ONLY
         /* We don't set these in system emulation mode for the moment,
-         * since we don't correctly set the ID registers to advertise them,
+         * since we don't correctly set (all of) the ID registers to
+         * advertise them.
          */
         set_feature(&cpu->env, ARM_FEATURE_V8);
-        set_feature(&cpu->env, ARM_FEATURE_V8_AES);
-        set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
-        set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
-        set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
-        set_feature(&cpu->env, ARM_FEATURE_CRC);
-        set_feature(&cpu->env, ARM_FEATURE_V8_RDM);
-        set_feature(&cpu->env, ARM_FEATURE_V8_DOTPROD);
-        set_feature(&cpu->env, ARM_FEATURE_V8_FCMA);
+        {
+            uint32_t t;
+
+            t = cpu->isar.id_isar5;
+            t = FIELD_DP32(t, ID_ISAR5, AES, 2);
+            t = FIELD_DP32(t, ID_ISAR5, SHA1, 1);
+            t = FIELD_DP32(t, ID_ISAR5, SHA2, 1);
+            t = FIELD_DP32(t, ID_ISAR5, CRC32, 1);
+            t = FIELD_DP32(t, ID_ISAR5, RDM, 1);
+            t = FIELD_DP32(t, ID_ISAR5, VCMA, 1);
+            cpu->isar.id_isar5 = t;
+
+            t = cpu->isar.id_isar6;
+            t = FIELD_DP32(t, ID_ISAR6, DP, 1);
+            cpu->isar.id_isar6 = t;
+        }
 #endif
     }
 }
diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu64.c
+++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_a57_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
     set_feature(&cpu->env, ARM_FEATURE_AARCH64);
     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
-    set_feature(&cpu->env, ARM_FEATURE_V8_AES);
-    set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
-    set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
-    set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
-    set_feature(&cpu->env, ARM_FEATURE_CRC);
     set_feature(&cpu->env, ARM_FEATURE_EL2);
     set_feature(&cpu->env, ARM_FEATURE_EL3);
     set_feature(&cpu->env, ARM_FEATURE_PMU);
@@ -XXX,XX +XXX,XX @@ static void aarch64_a53_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
     set_feature(&cpu->env, ARM_FEATURE_AARCH64);
     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
-    set_feature(&cpu->env, ARM_FEATURE_V8_AES);
-    set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
-    set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
-    set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
-    set_feature(&cpu->env, ARM_FEATURE_CRC);
     set_feature(&cpu->env, ARM_FEATURE_EL2);
     set_feature(&cpu->env, ARM_FEATURE_EL3);
     set_feature(&cpu->env, ARM_FEATURE_PMU);
@@ -XXX,XX +XXX,XX @@ static void aarch64_a72_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
     set_feature(&cpu->env, ARM_FEATURE_AARCH64);
     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
-    set_feature(&cpu->env, ARM_FEATURE_V8_AES);
-    set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
-    set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
-    set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
-    set_feature(&cpu->env, ARM_FEATURE_CRC);
     set_feature(&cpu->env, ARM_FEATURE_EL2);
     set_feature(&cpu->env, ARM_FEATURE_EL3);
     set_feature(&cpu->env, ARM_FEATURE_PMU);
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
     if (kvm_enabled()) {
         kvm_arm_set_cpu_features_from_host(cpu);
     } else {
+        uint64_t t;
+        uint32_t u;
         aarch64_a57_initfn(obj);
+
+        t = cpu->isar.id_aa64isar0;
+        t = FIELD_DP64(t, ID_AA64ISAR0, AES, 2); /* AES + PMULL */
+        t = FIELD_DP64(t, ID_AA64ISAR0, SHA1, 1);
+        t = FIELD_DP64(t, ID_AA64ISAR0, SHA2, 2); /* SHA512 */
+        t = FIELD_DP64(t, ID_AA64ISAR0, CRC32, 1);
+        t = FIELD_DP64(t, ID_AA64ISAR0, ATOMIC, 2);
+        t = FIELD_DP64(t, ID_AA64ISAR0, RDM, 1);
+        t = FIELD_DP64(t, ID_AA64ISAR0, SHA3, 1);
+        t = FIELD_DP64(t, ID_AA64ISAR0, SM3, 1);
+        t = FIELD_DP64(t, ID_AA64ISAR0, SM4, 1);
+        t = FIELD_DP64(t, ID_AA64ISAR0, DP, 1);
+        cpu->isar.id_aa64isar0 = t;
+
+        t = cpu->isar.id_aa64isar1;
+        t = FIELD_DP64(t, ID_AA64ISAR1, FCMA, 1);
+        cpu->isar.id_aa64isar1 = t;
+
+        /* Replicate the same data to the 32-bit id registers.  */
+        u = cpu->isar.id_isar5;
+        u = FIELD_DP32(u, ID_ISAR5, AES, 2); /* AES + PMULL */
+        u = FIELD_DP32(u, ID_ISAR5, SHA1, 1);
+        u = FIELD_DP32(u, ID_ISAR5, SHA2, 1);
+        u = FIELD_DP32(u, ID_ISAR5, CRC32, 1);
+        u = FIELD_DP32(u, ID_ISAR5, RDM, 1);
+        u = FIELD_DP32(u, ID_ISAR5, VCMA, 1);
+        cpu->isar.id_isar5 = u;
+
+        u = cpu->isar.id_isar6;
+        u = FIELD_DP32(u, ID_ISAR6, DP, 1);
+        cpu->isar.id_isar6 = u;
+
 #ifdef CONFIG_USER_ONLY
         /* We don't set these in system emulation mode for the moment,
          * since we don't correctly set the ID registers to advertise them,
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
          * whereas the architecture requires them to be present in both if
          * present in either.
          */
-        set_feature(&cpu->env, ARM_FEATURE_V8_SHA512);
-        set_feature(&cpu->env, ARM_FEATURE_V8_SHA3);
-        set_feature(&cpu->env, ARM_FEATURE_V8_SM3);
-        set_feature(&cpu->env, ARM_FEATURE_V8_SM4);
-        set_feature(&cpu->env, ARM_FEATURE_V8_ATOMICS);
-        set_feature(&cpu->env, ARM_FEATURE_V8_RDM);
-        set_feature(&cpu->env, ARM_FEATURE_V8_DOTPROD);
         set_feature(&cpu->env, ARM_FEATURE_V8_FP16);
-        set_feature(&cpu->env, ARM_FEATURE_V8_FCMA);
         set_feature(&cpu->env, ARM_FEATURE_SVE);
         /* For usermode -cpu max we can use a larger and more efficient DCZ
          * blocksize since we don't have to follow what the hardware does.
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
         }
         if (rt2 == 31
             && ((rt | rs) & 1) == 0
-            && arm_dc_feature(s, ARM_FEATURE_V8_ATOMICS)) {
+            && dc_isar_feature(aa64_atomics, s)) {
             /* CASP / CASPL */
             gen_compare_and_swap_pair(s, rs, rt, rn, size | 2);
             return;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
         }
         if (rt2 == 31
             && ((rt | rs) & 1) == 0
-            && arm_dc_feature(s, ARM_FEATURE_V8_ATOMICS)) {
+            && dc_isar_feature(aa64_atomics, s)) {
             /* CASPA / CASPAL */
             gen_compare_and_swap_pair(s, rs, rt, rn, size | 2);
             return;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
     case 0xb: /* CASL */
     case 0xe: /* CASA */
     case 0xf: /* CASAL */
-        if (rt2 == 31 && arm_dc_feature(s, ARM_FEATURE_V8_ATOMICS)) {
+        if (rt2 == 31 && dc_isar_feature(aa64_atomics, s)) {
             gen_compare_and_swap(s, rs, rt, rn, size);
             return;
         }
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_atomic(DisasContext *s, uint32_t insn,
     int rs = extract32(insn, 16, 5);
     int rn = extract32(insn, 5, 5);
     int o3_opc = extract32(insn, 12, 4);
-    int feature = ARM_FEATURE_V8_ATOMICS;
     TCGv_i64 tcg_rn, tcg_rs;
     AtomicThreeOpFn *fn;
 
-    if (is_vector) {
+    if (is_vector || !dc_isar_feature(aa64_atomics, s)) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_atomic(DisasContext *s, uint32_t insn,
         unallocated_encoding(s);
         return;
     }
-    if (!arm_dc_feature(s, feature)) {
-        unallocated_encoding(s);
-        return;
-    }
 
     if (rn == 31) {
         gen_check_sp_alignment(s);
@@ -XXX,XX +XXX,XX @@ static void handle_crc32(DisasContext *s,
     TCGv_i64 tcg_acc, tcg_val;
     TCGv_i32 tcg_bytes;
 
-    if (!arm_dc_feature(s, ARM_FEATURE_CRC)
+    if (!dc_isar_feature(aa64_crc32, s)
         || (sf == 1 && sz != 3)
         || (sf == 0 && sz == 3)) {
         unallocated_encoding(s);
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_three_reg_same_extra(DisasContext *s,
     bool u = extract32(insn, 29, 1);
     TCGv_i32 ele1, ele2, ele3;
     TCGv_i64 res;
-    int feature;
+    bool feature;
 
     switch (u * 16 + opcode) {
     case 0x10: /* SQRDMLAH (vector) */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_three_reg_same_extra(DisasContext *s,
             unallocated_encoding(s);
             return;
         }
-        feature = ARM_FEATURE_V8_RDM;
+        feature = dc_isar_feature(aa64_rdm, s);
         break;
     default:
         unallocated_encoding(s);
         return;
     }
-    if (!arm_dc_feature(s, feature)) {
+    if (!feature) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_diff(DisasContext *s, uint32_t insn)
             return;
         }
         if (size == 3) {
-            if (!arm_dc_feature(s, ARM_FEATURE_V8_PMULL)) {
+            if (!dc_isar_feature(aa64_pmull, s)) {
                 unallocated_encoding(s);
                 return;
             }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
     int size = extract32(insn, 22, 2);
     bool u = extract32(insn, 29, 1);
     bool is_q = extract32(insn, 30, 1);
-    int feature, rot;
+    bool feature;
+    int rot;
 
     switch (u * 16 + opcode) {
     case 0x10: /* SQRDMLAH (vector) */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
             unallocated_encoding(s);
             return;
         }
-        feature = ARM_FEATURE_V8_RDM;
+        feature = dc_isar_feature(aa64_rdm, s);
         break;
     case 0x02: /* SDOT (vector) */
     case 0x12: /* UDOT (vector) */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
             unallocated_encoding(s);
             return;
         }
-        feature = ARM_FEATURE_V8_DOTPROD;
+        feature = dc_isar_feature(aa64_dp, s);
         break;
     case 0x18: /* FCMLA, #0 */
     case 0x19: /* FCMLA, #90 */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
             unallocated_encoding(s);
             return;
         }
-        feature = ARM_FEATURE_V8_FCMA;
+        feature = dc_isar_feature(aa64_fcma, s);
         break;
     default:
         unallocated_encoding(s);
         return;
     }
-    if (!arm_dc_feature(s, feature)) {
+    if (!feature) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
         break;
     case 0x1d: /* SQRDMLAH */
     case 0x1f: /* SQRDMLSH */
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_RDM)) {
+        if (!dc_isar_feature(aa64_rdm, s)) {
             unallocated_encoding(s);
             return;
         }
         break;
     case 0x0e: /* SDOT */
     case 0x1e: /* UDOT */
-        if (size != MO_32 || !arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
+        if (size != MO_32 || !dc_isar_feature(aa64_dp, s)) {
             unallocated_encoding(s);
             return;
         }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
     case 0x13: /* FCMLA #90 */
     case 0x15: /* FCMLA #180 */
     case 0x17: /* FCMLA #270 */
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)) {
+        if (!dc_isar_feature(aa64_fcma, s)) {
             unallocated_encoding(s);
             return;
         }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_aes(DisasContext *s, uint32_t insn)
     TCGv_i32 tcg_decrypt;
     CryptoThreeOpIntFn *genfn;
 
-    if (!arm_dc_feature(s, ARM_FEATURE_V8_AES)
-        || size != 0) {
+    if (!dc_isar_feature(aa64_aes, s) || size != 0) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_sha(DisasContext *s, uint32_t insn)
     int rd = extract32(insn, 0, 5);
     CryptoThreeOpFn *genfn;
     TCGv_ptr tcg_rd_ptr, tcg_rn_ptr, tcg_rm_ptr;
-    int feature = ARM_FEATURE_V8_SHA256;
+    bool feature;
 
     if (size != 0) {
         unallocated_encoding(s);
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_sha(DisasContext *s, uint32_t insn)
     case 2: /* SHA1M */
     case 3: /* SHA1SU0 */
         genfn = NULL;
-        feature = ARM_FEATURE_V8_SHA1;
+        feature = dc_isar_feature(aa64_sha1, s);
         break;
     case 4: /* SHA256H */
         genfn = gen_helper_crypto_sha256h;
+        feature = dc_isar_feature(aa64_sha256, s);
         break;
     case 5: /* SHA256H2 */
         genfn = gen_helper_crypto_sha256h2;
+        feature = dc_isar_feature(aa64_sha256, s);
         break;
     case 6: /* SHA256SU1 */
         genfn = gen_helper_crypto_sha256su1;
+        feature = dc_isar_feature(aa64_sha256, s);
         break;
     default:
         unallocated_encoding(s);
         return;
     }
 
-    if (!arm_dc_feature(s, feature)) {
+    if (!feature) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha(DisasContext *s, uint32_t insn)
     int rn = extract32(insn, 5, 5);
     int rd = extract32(insn, 0, 5);
     CryptoTwoOpFn *genfn;
-    int feature;
+    bool feature;
     TCGv_ptr tcg_rd_ptr, tcg_rn_ptr;
 
     if (size != 0) {
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha(DisasContext *s, uint32_t insn)
 
     switch (opcode) {
     case 0: /* SHA1H */
-        feature = ARM_FEATURE_V8_SHA1;
+        feature = dc_isar_feature(aa64_sha1, s);
         genfn = gen_helper_crypto_sha1h;
         break;
     case 1: /* SHA1SU1 */
-        feature = ARM_FEATURE_V8_SHA1;
+        feature = dc_isar_feature(aa64_sha1, s);
         genfn = gen_helper_crypto_sha1su1;
         break;
     case 2: /* SHA256SU0 */
-        feature = ARM_FEATURE_V8_SHA256;
+        feature = dc_isar_feature(aa64_sha256, s);
         genfn = gen_helper_crypto_sha256su0;
         break;
     default:
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha(DisasContext *s, uint32_t insn)
         return;
     }
 
-    if (!arm_dc_feature(s, feature)) {
+    if (!feature) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_sha512(DisasContext *s, uint32_t insn)
     int rm = extract32(insn, 16, 5);
     int rn = extract32(insn, 5, 5);
     int rd = extract32(insn, 0, 5);
-    int feature;
+    bool feature;
     CryptoThreeOpFn *genfn;
 
     if (o == 0) {
         switch (opcode) {
         case 0: /* SHA512H */
-            feature = ARM_FEATURE_V8_SHA512;
+            feature = dc_isar_feature(aa64_sha512, s);
             genfn = gen_helper_crypto_sha512h;
             break;
         case 1: /* SHA512H2 */
-            feature = ARM_FEATURE_V8_SHA512;
+            feature = dc_isar_feature(aa64_sha512, s);
             genfn = gen_helper_crypto_sha512h2;
             break;
         case 2: /* SHA512SU1 */
-            feature = ARM_FEATURE_V8_SHA512;
+            feature = dc_isar_feature(aa64_sha512, s);
             genfn = gen_helper_crypto_sha512su1;
             break;
         case 3: /* RAX1 */
-            feature = ARM_FEATURE_V8_SHA3;
+            feature = dc_isar_feature(aa64_sha3, s);
             genfn = NULL;
             break;
         }
     } else {
         switch (opcode) {
         case 0: /* SM3PARTW1 */
-            feature = ARM_FEATURE_V8_SM3;
+            feature = dc_isar_feature(aa64_sm3, s);
             genfn = gen_helper_crypto_sm3partw1;
             break;
         case 1: /* SM3PARTW2 */
-            feature = ARM_FEATURE_V8_SM3;
+            feature = dc_isar_feature(aa64_sm3, s);
             genfn = gen_helper_crypto_sm3partw2;
             break;
         case 2: /* SM4EKEY */
-            feature = ARM_FEATURE_V8_SM4;
+            feature = dc_isar_feature(aa64_sm4, s);
             genfn = gen_helper_crypto_sm4ekey;
             break;
         default:
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_sha512(DisasContext *s, uint32_t insn)
         }
     }
 
-    if (!arm_dc_feature(s, feature)) {
+    if (!feature) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha512(DisasContext *s, uint32_t insn)
     int rn = extract32(insn, 5, 5);
     int rd = extract32(insn, 0, 5);
     TCGv_ptr tcg_rd_ptr, tcg_rn_ptr;
-    int feature;
+    bool feature;
     CryptoTwoOpFn *genfn;
 
     switch (opcode) {
     case 0: /* SHA512SU0 */
-        feature = ARM_FEATURE_V8_SHA512;
+        feature = dc_isar_feature(aa64_sha512, s);
         genfn = gen_helper_crypto_sha512su0;
         break;
     case 1: /* SM4E */
-        feature = ARM_FEATURE_V8_SM4;
+        feature = dc_isar_feature(aa64_sm4, s);
         genfn = gen_helper_crypto_sm4e;
         break;
     default:
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_two_reg_sha512(DisasContext *s, uint32_t insn)
         return;
     }
 
-    if (!arm_dc_feature(s, feature)) {
+    if (!feature) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_four_reg(DisasContext *s, uint32_t insn)
     int ra = extract32(insn, 10, 5);
     int rn = extract32(insn, 5, 5);
     int rd = extract32(insn, 0, 5);
-    int feature;
+    bool feature;
 
     switch (op0) {
     case 0: /* EOR3 */
     case 1: /* BCAX */
-        feature = ARM_FEATURE_V8_SHA3;
+        feature = dc_isar_feature(aa64_sha3, s);
         break;
     case 2: /* SM3SS1 */
-        feature = ARM_FEATURE_V8_SM3;
+        feature = dc_isar_feature(aa64_sm3, s);
         break;
     default:
         unallocated_encoding(s);
         return;
     }
 
-    if (!arm_dc_feature(s, feature)) {
+    if (!feature) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_xar(DisasContext *s, uint32_t insn)
     TCGv_i64 tcg_op1, tcg_op2, tcg_res[2];
     int pass;
 
-    if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA3)) {
+    if (!dc_isar_feature(aa64_sha3, s)) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_crypto_three_reg_imm2(DisasContext *s, uint32_t insn)
     TCGv_ptr tcg_rd_ptr, tcg_rn_ptr, tcg_rm_ptr;
     TCGv_i32 tcg_imm2, tcg_opcode;
 
-    if (!arm_dc_feature(s, ARM_FEATURE_V8_SM3)) {
+    if (!dc_isar_feature(aa64_sm3, s)) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_init_disas_context(DisasContextBase *dcbase,
     ARMCPU *arm_cpu = arm_env_get_cpu(env);
     int bound;
 
+    dc->isar = &arm_cpu->isar;
     dc->pc = dc->base.pc_first;
     dc->condjmp = 0;
 
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static const uint8_t neon_2rm_sizes[] = {
 static int do_v81_helper(DisasContext *s, gen_helper_gvec_3_ptr *fn,
                          int q, int rd, int rn, int rm)
 {
-    if (arm_dc_feature(s, ARM_FEATURE_V8_RDM)) {
+    if (dc_isar_feature(aa32_rdm, s)) {
         int opr_sz = (1 + q) * 8;
         tcg_gen_gvec_3_ptr(vfp_reg_offset(1, rd),
                            vfp_reg_offset(1, rn),
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 return 1;
             }
             if (!u) { /* SHA-1 */
-                if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA1)) {
+                if (!dc_isar_feature(aa32_sha1, s)) {
                     return 1;
                 }
                 ptr1 = vfp_reg_ptr(true, rd);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 gen_helper_crypto_sha1_3reg(ptr1, ptr2, ptr3, tmp4);
                 tcg_temp_free_i32(tmp4);
             } else { /* SHA-256 */
-                if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA256) || size == 3) {
+                if (!dc_isar_feature(aa32_sha2, s) || size == 3) {
                     return 1;
                 }
                 ptr1 = vfp_reg_ptr(true, rd);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 if (op == 14 && size == 2) {
                     TCGv_i64 tcg_rn, tcg_rm, tcg_rd;
 
-                    if (!arm_dc_feature(s, ARM_FEATURE_V8_PMULL)) {
+                    if (!dc_isar_feature(aa32_pmull, s)) {
                         return 1;
                     }
                     tcg_rn = tcg_temp_new_i64();
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                     {
                         NeonGenThreeOpEnvFn *fn;
 
-                        if (!arm_dc_feature(s, ARM_FEATURE_V8_RDM)) {
+                        if (!dc_isar_feature(aa32_rdm, s)) {
                             return 1;
                         }
                         if (u && ((rd | rn) & 1)) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                     break;
                 }
                 case NEON_2RM_AESE: case NEON_2RM_AESMC:
-                    if (!arm_dc_feature(s, ARM_FEATURE_V8_AES)
-                        || ((rm | rd) & 1)) {
+                    if (!dc_isar_feature(aa32_aes, s) || ((rm | rd) & 1)) {
                         return 1;
                     }
                     ptr1 = vfp_reg_ptr(true, rd);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                     tcg_temp_free_i32(tmp3);
                     break;
                 case NEON_2RM_SHA1H:
-                    if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA1)
-                        || ((rm | rd) & 1)) {
+                    if (!dc_isar_feature(aa32_sha1, s) || ((rm | rd) & 1)) {
                         return 1;
                     }
                     ptr1 = vfp_reg_ptr(true, rd);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                     }
                     /* bit 6 (q): set -> SHA256SU0, cleared -> SHA1SU1 */
                     if (q) {
-                        if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA256)) {
+                        if (!dc_isar_feature(aa32_sha2, s)) {
                             return 1;
                         }
-                    } else if (!arm_dc_feature(s, ARM_FEATURE_V8_SHA1)) {
+                    } else if (!dc_isar_feature(aa32_sha1, s)) {
                         return 1;
                     }
                     ptr1 = vfp_reg_ptr(true, rd);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
         /* VCMLA -- 1111 110R R.1S .... .... 1000 ...0 .... */
         int size = extract32(insn, 20, 1);
         data = extract32(insn, 23, 2); /* rot */
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)
+        if (!dc_isar_feature(aa32_vcma, s)
             || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
             return 1;
         }
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
         /* VCADD -- 1111 110R 1.0S .... .... 1000 ...0 .... */
         int size = extract32(insn, 20, 1);
         data = extract32(insn, 24, 1); /* rot */
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)
+        if (!dc_isar_feature(aa32_vcma, s)
             || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
             return 1;
         }
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
     } else if ((insn & 0xfeb00f00) == 0xfc200d00) {
         /* V[US]DOT -- 1111 1100 0.10 .... .... 1101 .Q.U .... */
         bool u = extract32(insn, 4, 1);
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
+        if (!dc_isar_feature(aa32_dp, s)) {
             return 1;
         }
         fn_gvec = u ? gen_helper_gvec_udot_b : gen_helper_gvec_sdot_b;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
         int size = extract32(insn, 23, 1);
         int index;
 
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)) {
+        if (!dc_isar_feature(aa32_vcma, s)) {
             return 1;
         }
         if (size == 0) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
     } else if ((insn & 0xffb00f00) == 0xfe200d00) {
         /* V[US]DOT -- 1111 1110 0.10 .... .... 1101 .Q.U .... */
         int u = extract32(insn, 4, 1);
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
+        if (!dc_isar_feature(aa32_dp, s)) {
             return 1;
         }
         fn_gvec = u ? gen_helper_gvec_udot_idx_b : gen_helper_gvec_sdot_idx_b;
@@ -XXX,XX +XXX,XX @@ static void disas_arm_insn(DisasContext *s, unsigned int insn)
              * op1 == 3 is UNPREDICTABLE but handle as UNDEFINED.
              * Bits 8, 10 and 11 should be zero.
              */
-            if (!arm_dc_feature(s, ARM_FEATURE_CRC) || op1 == 0x3 ||
-                (c & 0xd) != 0) {
+            if (!dc_isar_feature(aa32_crc32, s) || op1 == 0x3 || (c & 0xd) != 0) {
                 goto illegal_op;
             }
 
@@ -XXX,XX +XXX,XX @@ static void disas_thumb2_insn(DisasContext *s, uint32_t insn)
                 case 0x28:
                 case 0x29:
                 case 0x2a:
-                    if (!arm_dc_feature(s, ARM_FEATURE_CRC)) {
+                    if (!dc_isar_feature(aa32_crc32, s)) {
                         goto illegal_op;
                     }
                     break;
@@ -XXX,XX +XXX,XX @@ static void arm_tr_init_disas_context(DisasContextBase *dcbase, CPUState *cs)
     CPUARMState *env = cs->env_ptr;
     ARMCPU *cpu = arm_env_get_cpu(env);
 
+    dc->isar = &cpu->isar;
     dc->pc = dc->base.pc_first;
     dc->condjmp = 0;
 
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Both arm and thumb2 division are controlled by the same ISAR field,
which takes care of the arm implies thumb case.  Having M imply
thumb2 division was wrong for cortex-m0, which is v6m and does not
have thumb2 at all, much less thumb2 division.

Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181016223115.24100-5-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h       | 12 ++++++++++--
 linux-user/elfload.c   |  4 ++--
 target/arm/cpu.c       | 10 +---------
 target/arm/translate.c |  4 ++--
 4 files changed, 15 insertions(+), 15 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ enum arm_features {
     ARM_FEATURE_VFP3,
     ARM_FEATURE_VFP_FP16,
     ARM_FEATURE_NEON,
-    ARM_FEATURE_THUMB_DIV, /* divide supported in Thumb encoding */
     ARM_FEATURE_M, /* Microcontroller profile.  */
     ARM_FEATURE_OMAPCP, /* OMAP specific CP15 ops handling.  */
     ARM_FEATURE_THUMB2EE,
@@ -XXX,XX +XXX,XX @@ enum arm_features {
     ARM_FEATURE_V5,
     ARM_FEATURE_STRONGARM,
     ARM_FEATURE_VAPA, /* cp15 VA to PA lookups */
-    ARM_FEATURE_ARM_DIV, /* divide supported in ARM encoding */
     ARM_FEATURE_VFP4, /* VFPv4 (implies that NEON is v2) */
     ARM_FEATURE_GENERIC_TIMER,
     ARM_FEATURE_MVFR, /* Media and VFP Feature Registers 0 and 1 */
@@ -XXX,XX +XXX,XX @@ extern const uint64_t pred_esz_masks[4];
 /*
  * 32-bit feature tests via id registers.
  */
+static inline bool isar_feature_thumb_div(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar0, ID_ISAR0, DIVIDE) != 0;
+}
+
+static inline bool isar_feature_arm_div(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar0, ID_ISAR0, DIVIDE) > 1;
+}
+
 static inline bool isar_feature_aa32_aes(const ARMISARegisters *id)
 {
     return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) != 0;
diff --git a/linux-user/elfload.c b/linux-user/elfload.c
index XXXXXXX..XXXXXXX 100644
--- a/linux-user/elfload.c
+++ b/linux-user/elfload.c
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
     GET_FEATURE(ARM_FEATURE_VFP3, ARM_HWCAP_ARM_VFPv3);
     GET_FEATURE(ARM_FEATURE_V6K, ARM_HWCAP_ARM_TLS);
     GET_FEATURE(ARM_FEATURE_VFP4, ARM_HWCAP_ARM_VFPv4);
-    GET_FEATURE(ARM_FEATURE_ARM_DIV, ARM_HWCAP_ARM_IDIVA);
-    GET_FEATURE(ARM_FEATURE_THUMB_DIV, ARM_HWCAP_ARM_IDIVT);
+    GET_FEATURE_ID(arm_div, ARM_HWCAP_ARM_IDIVA);
+    GET_FEATURE_ID(thumb_div, ARM_HWCAP_ARM_IDIVT);
     /* All QEMU's VFPv3 CPUs have 32 registers, see VFP_DREG in translate.c.
      * Note that the ARM_HWCAP_ARM_VFPv3D16 bit is always the inverse of
      * ARM_HWCAP_ARM_VFPD32 (and so always clear for QEMU); it is unrelated
diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
          * Presence of EL2 itself is ARM_FEATURE_EL2, and of the
          * Security Extensions is ARM_FEATURE_EL3.
          */
-        set_feature(env, ARM_FEATURE_ARM_DIV);
+        assert(cpu_isar_feature(arm_div, cpu));
         set_feature(env, ARM_FEATURE_LPAE);
         set_feature(env, ARM_FEATURE_V7);
     }
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
     if (arm_feature(env, ARM_FEATURE_V5)) {
         set_feature(env, ARM_FEATURE_V4T);
     }
-    if (arm_feature(env, ARM_FEATURE_M)) {
-        set_feature(env, ARM_FEATURE_THUMB_DIV);
-    }
-    if (arm_feature(env, ARM_FEATURE_ARM_DIV)) {
-        set_feature(env, ARM_FEATURE_THUMB_DIV);
-    }
     if (arm_feature(env, ARM_FEATURE_VFP4)) {
         set_feature(env, ARM_FEATURE_VFP3);
         set_feature(env, ARM_FEATURE_VFP_FP16);
@@ -XXX,XX +XXX,XX @@ static void cortex_r5_initfn(Object *obj)
     ARMCPU *cpu = ARM_CPU(obj);
 
     set_feature(&cpu->env, ARM_FEATURE_V7);
-    set_feature(&cpu->env, ARM_FEATURE_THUMB_DIV);
-    set_feature(&cpu->env, ARM_FEATURE_ARM_DIV);
     set_feature(&cpu->env, ARM_FEATURE_V7MP);
     set_feature(&cpu->env, ARM_FEATURE_PMSA);
     cpu->midr = 0x411fc153; /* r1p3 */
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void disas_arm_insn(DisasContext *s, unsigned int insn)
                     case 1:
                     case 3:
                         /* SDIV, UDIV */
-                        if (!arm_dc_feature(s, ARM_FEATURE_ARM_DIV)) {
+                        if (!dc_isar_feature(arm_div, s)) {
                             goto illegal_op;
                         }
                         if (((insn >> 5) & 7) || (rd != 15)) {
@@ -XXX,XX +XXX,XX @@ static void disas_thumb2_insn(DisasContext *s, uint32_t insn)
             tmp2 = load_reg(s, rm);
             if ((op & 0x50) == 0x10) {
                 /* sdiv, udiv */
-                if (!arm_dc_feature(s, ARM_FEATURE_THUMB_DIV)) {
+                if (!dc_isar_feature(thumb_div, s)) {
                     goto illegal_op;
                 }
                 if (op & 0x20)
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Having V6 alone imply jazelle was wrong for cortex-m0.
Change to an assertion for V6 & !M.

This was harmless, because the only place we tested ARM_FEATURE_JAZELLE
was for 'bxj' in disas_arm(), which is unreachable for M-profile cores.

Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181016223115.24100-6-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h       |  6 +++++-
 target/arm/cpu.c       | 17 ++++++++++++++---
 target/arm/translate.c |  2 +-
 3 files changed, 20 insertions(+), 5 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181016223115.24100-7-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h     | 6 +++++-
 linux-user/elfload.c | 2 +-
 target/arm/cpu.c     | 4 ----
 target/arm/helper.c  | 2 +-
 target/arm/machine.c | 3 +--
 5 files changed, 8 insertions(+), 9 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ enum arm_features {
     ARM_FEATURE_NEON,
     ARM_FEATURE_M, /* Microcontroller profile.  */
     ARM_FEATURE_OMAPCP, /* OMAP specific CP15 ops handling.  */
-    ARM_FEATURE_THUMB2EE,
     ARM_FEATURE_V7MP,    /* v7 Multiprocessing Extensions */
     ARM_FEATURE_V7VE, /* v7 Virtualization Extensions (non-EL2 parts) */
     ARM_FEATURE_V4T,
@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_jazelle(const ARMISARegisters *id)
     return FIELD_EX32(id->id_isar1, ID_ISAR1, JAZELLE) != 0;
 }
 
+static inline bool isar_feature_t32ee(const ARMISARegisters *id)
+{
+    return FIELD_EX32(id->id_isar3, ID_ISAR3, T32EE) != 0;
+}
+
 static inline bool isar_feature_aa32_aes(const ARMISARegisters *id)
 {
     return FIELD_EX32(id->id_isar5, ID_ISAR5, AES) != 0;
diff --git a/linux-user/elfload.c b/linux-user/elfload.c
index XXXXXXX..XXXXXXX 100644
--- a/linux-user/elfload.c
+++ b/linux-user/elfload.c
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
     GET_FEATURE(ARM_FEATURE_V5, ARM_HWCAP_ARM_EDSP);
     GET_FEATURE(ARM_FEATURE_VFP, ARM_HWCAP_ARM_VFP);
     GET_FEATURE(ARM_FEATURE_IWMMXT, ARM_HWCAP_ARM_IWMMXT);
-    GET_FEATURE(ARM_FEATURE_THUMB2EE, ARM_HWCAP_ARM_THUMBEE);
+    GET_FEATURE_ID(t32ee, ARM_HWCAP_ARM_THUMBEE);
     GET_FEATURE(ARM_FEATURE_NEON, ARM_HWCAP_ARM_NEON);
     GET_FEATURE(ARM_FEATURE_VFP3, ARM_HWCAP_ARM_VFPv3);
     GET_FEATURE(ARM_FEATURE_V6K, ARM_HWCAP_ARM_TLS);
diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void cortex_a8_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_V7);
     set_feature(&cpu->env, ARM_FEATURE_VFP3);
     set_feature(&cpu->env, ARM_FEATURE_NEON);
-    set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
     set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
     set_feature(&cpu->env, ARM_FEATURE_EL3);
     cpu->midr = 0x410fc080;
@@ -XXX,XX +XXX,XX @@ static void cortex_a9_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_VFP3);
     set_feature(&cpu->env, ARM_FEATURE_VFP_FP16);
     set_feature(&cpu->env, ARM_FEATURE_NEON);
-    set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
     set_feature(&cpu->env, ARM_FEATURE_EL3);
     /* Note that A9 supports the MP extensions even for
      * A9UP and single-core A9MP (which are both different
@@ -XXX,XX +XXX,XX @@ static void cortex_a7_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_V7VE);
     set_feature(&cpu->env, ARM_FEATURE_VFP4);
     set_feature(&cpu->env, ARM_FEATURE_NEON);
-    set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
     set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
@@ -XXX,XX +XXX,XX @@ static void cortex_a15_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_V7VE);
     set_feature(&cpu->env, ARM_FEATURE_VFP4);
     set_feature(&cpu->env, ARM_FEATURE_NEON);
-    set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
     set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
         define_arm_cp_regs(cpu, vmsa_pmsa_cp_reginfo);
         define_arm_cp_regs(cpu, vmsa_cp_reginfo);
     }
-    if (arm_feature(env, ARM_FEATURE_THUMB2EE)) {
+    if (cpu_isar_feature(t32ee, cpu)) {
         define_arm_cp_regs(cpu, t2ee_cp_reginfo);
     }
     if (arm_feature(env, ARM_FEATURE_GENERIC_TIMER)) {
diff --git a/target/arm/machine.c b/target/arm/machine.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/machine.c
+++ b/target/arm/machine.c
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_m = {
 static bool thumb2ee_needed(void *opaque)
 {
     ARMCPU *cpu = opaque;
-    CPUARMState *env = &cpu->env;
 
-    return arm_feature(env, ARM_FEATURE_THUMB2EE);
+    return cpu_isar_feature(t32ee, cpu);
 }
 
 static const VMStateDescription vmstate_thumb2ee = {
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181016223115.24100-8-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h            | 16 +++++++++++++++-
 linux-user/aarch64/signal.c |  4 ++--
 linux-user/elfload.c        |  2 +-
 linux-user/syscall.c        | 10 ++++++----
 target/arm/cpu64.c          |  5 ++++-
 target/arm/helper.c         |  9 ++++++---
 target/arm/machine.c        |  3 +--
 target/arm/translate-a64.c  |  4 ++--
 8 files changed, 37 insertions(+), 16 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ FIELD(ID_AA64ISAR1, FRINTTS, 32, 4)
 FIELD(ID_AA64ISAR1, SB, 36, 4)
 FIELD(ID_AA64ISAR1, SPECRES, 40, 4)
 
+FIELD(ID_AA64PFR0, EL0, 0, 4)
+FIELD(ID_AA64PFR0, EL1, 4, 4)
+FIELD(ID_AA64PFR0, EL2, 8, 4)
+FIELD(ID_AA64PFR0, EL3, 12, 4)
+FIELD(ID_AA64PFR0, FP, 16, 4)
+FIELD(ID_AA64PFR0, ADVSIMD, 20, 4)
+FIELD(ID_AA64PFR0, GIC, 24, 4)
+FIELD(ID_AA64PFR0, RAS, 28, 4)
+FIELD(ID_AA64PFR0, SVE, 32, 4)
+
 QEMU_BUILD_BUG_ON(ARRAY_SIZE(((ARMCPU *)0)->ccsidr) <= R_V7M_CSSELR_INDEX_MASK);
 
 /* If adding a feature bit which corresponds to a Linux ELF
@@ -XXX,XX +XXX,XX @@ enum arm_features {
     ARM_FEATURE_PMU, /* has PMU support */
     ARM_FEATURE_VBAR, /* has cp15 VBAR */
     ARM_FEATURE_M_SECURITY, /* M profile Security Extension */
-    ARM_FEATURE_SVE, /* has Scalable Vector Extension */
     ARM_FEATURE_V8_FP16, /* implements v8.2 half-precision float */
     ARM_FEATURE_M_MAIN, /* M profile Main Extension */
 };
@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_aa64_fcma(const ARMISARegisters *id)
     return FIELD_EX64(id->id_aa64isar1, ID_AA64ISAR1, FCMA) != 0;
 }
 
+static inline bool isar_feature_aa64_sve(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64pfr0, ID_AA64PFR0, SVE) != 0;
+}
+
 /*
  * Forward to the above feature tests given an ARMCPU pointer.
  */
diff --git a/linux-user/aarch64/signal.c b/linux-user/aarch64/signal.c
index XXXXXXX..XXXXXXX 100644
--- a/linux-user/aarch64/signal.c
+++ b/linux-user/aarch64/signal.c
@@ -XXX,XX +XXX,XX @@ static int target_restore_sigframe(CPUARMState *env,
             break;
 
         case TARGET_SVE_MAGIC:
-            if (arm_feature(env, ARM_FEATURE_SVE)) {
+            if (cpu_isar_feature(aa64_sve, arm_env_get_cpu(env))) {
                 vq = (env->vfp.zcr_el[1] & 0xf) + 1;
                 sve_size = QEMU_ALIGN_UP(TARGET_SVE_SIG_CONTEXT_SIZE(vq), 16);
                 if (!sve && size == sve_size) {
@@ -XXX,XX +XXX,XX @@ static void target_setup_frame(int usig, struct target_sigaction *ka,
                                       &layout);
 
     /* SVE state needs saving only if it exists.  */
-    if (arm_feature(env, ARM_FEATURE_SVE)) {
+    if (cpu_isar_feature(aa64_sve, arm_env_get_cpu(env))) {
         vq = (env->vfp.zcr_el[1] & 0xf) + 1;
         sve_size = QEMU_ALIGN_UP(TARGET_SVE_SIG_CONTEXT_SIZE(vq), 16);
         sve_ofs = alloc_sigframe_space(sve_size, &layout);
diff --git a/linux-user/elfload.c b/linux-user/elfload.c
index XXXXXXX..XXXXXXX 100644
--- a/linux-user/elfload.c
+++ b/linux-user/elfload.c
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
     GET_FEATURE_ID(aa64_rdm, ARM_HWCAP_A64_ASIMDRDM);
     GET_FEATURE_ID(aa64_dp, ARM_HWCAP_A64_ASIMDDP);
     GET_FEATURE_ID(aa64_fcma, ARM_HWCAP_A64_FCMA);
-    GET_FEATURE(ARM_FEATURE_SVE, ARM_HWCAP_A64_SVE);
+    GET_FEATURE_ID(aa64_sve, ARM_HWCAP_A64_SVE);
 
 #undef GET_FEATURE
 #undef GET_FEATURE_ID
diff --git a/linux-user/syscall.c b/linux-user/syscall.c
index XXXXXXX..XXXXXXX 100644
--- a/linux-user/syscall.c
+++ b/linux-user/syscall.c
@@ -XXX,XX +XXX,XX @@ static abi_long do_syscall1(void *cpu_env, int num, abi_long arg1,
              * even though the current architectural maximum is VQ=16.
              */
             ret = -TARGET_EINVAL;
-            if (arm_feature(cpu_env, ARM_FEATURE_SVE)
+            if (cpu_isar_feature(aa64_sve, arm_env_get_cpu(cpu_env))
                 && arg2 >= 0 && arg2 <= 512 * 16 && !(arg2 & 15)) {
                 CPUARMState *env = cpu_env;
                 ARMCPU *cpu = arm_env_get_cpu(env);
@@ -XXX,XX +XXX,XX @@ static abi_long do_syscall1(void *cpu_env, int num, abi_long arg1,
             return ret;
         case TARGET_PR_SVE_GET_VL:
             ret = -TARGET_EINVAL;
-            if (arm_feature(cpu_env, ARM_FEATURE_SVE)) {
-                CPUARMState *env = cpu_env;
-                ret = ((env->vfp.zcr_el[1] & 0xf) + 1) * 16;
+            {
+                ARMCPU *cpu = arm_env_get_cpu(cpu_env);
+                if (cpu_isar_feature(aa64_sve, cpu)) {
+                    ret = ((cpu->env.vfp.zcr_el[1] & 0xf) + 1) * 16;
+                }
             }
             return ret;
 #endif /* AARCH64 */
diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu64.c
+++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
         t = FIELD_DP64(t, ID_AA64ISAR1, FCMA, 1);
         cpu->isar.id_aa64isar1 = t;
 
+        t = cpu->isar.id_aa64pfr0;
+        t = FIELD_DP64(t, ID_AA64PFR0, SVE, 1);
+        cpu->isar.id_aa64pfr0 = t;
+
         /* Replicate the same data to the 32-bit id registers.  */
         u = cpu->isar.id_isar5;
         u = FIELD_DP32(u, ID_ISAR5, AES, 2); /* AES + PMULL */
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
          * present in either.
          */
         set_feature(&cpu->env, ARM_FEATURE_V8_FP16);
-        set_feature(&cpu->env, ARM_FEATURE_SVE);
         /* For usermode -cpu max we can use a larger and more efficient DCZ
          * blocksize since we don't have to follow what the hardware does.
          */
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
         define_one_arm_cp_reg(cpu, &sctlr);
     }
 
-    if (arm_feature(env, ARM_FEATURE_SVE)) {
+    if (cpu_isar_feature(aa64_sve, cpu)) {
         define_one_arm_cp_reg(cpu, &zcr_el1_reginfo);
         if (arm_feature(env, ARM_FEATURE_EL2)) {
             define_one_arm_cp_reg(cpu, &zcr_el2_reginfo);
@@ -XXX,XX +XXX,XX @@ void cpu_get_tb_cpu_state(CPUARMState *env, target_ulong *pc,
     uint32_t flags;
 
     if (is_a64(env)) {
+        ARMCPU *cpu = arm_env_get_cpu(env);
+
         *pc = env->pc;
         flags = ARM_TBFLAG_AARCH64_STATE_MASK;
         /* Get control bits for tagged addresses */
         flags |= (arm_regime_tbi0(env, mmu_idx) << ARM_TBFLAG_TBI0_SHIFT);
         flags |= (arm_regime_tbi1(env, mmu_idx) << ARM_TBFLAG_TBI1_SHIFT);
 
-        if (arm_feature(env, ARM_FEATURE_SVE)) {
+        if (cpu_isar_feature(aa64_sve, cpu)) {
             int sve_el = sve_exception_el(env, current_el);
             uint32_t zcr_len;
 
@@ -XXX,XX +XXX,XX @@ void aarch64_sve_narrow_vq(CPUARMState *env, unsigned vq)
 void aarch64_sve_change_el(CPUARMState *env, int old_el,
                            int new_el, bool el0_a64)
 {
+    ARMCPU *cpu = arm_env_get_cpu(env);
     int old_len, new_len;
     bool old_a64, new_a64;
 
     /* Nothing to do if no SVE.  */
-    if (!arm_feature(env, ARM_FEATURE_SVE)) {
+    if (!cpu_isar_feature(aa64_sve, cpu)) {
         return;
     }
 
diff --git a/target/arm/machine.c b/target/arm/machine.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/machine.c
+++ b/target/arm/machine.c
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_iwmmxt = {
 static bool sve_needed(void *opaque)
 {
     ARMCPU *cpu = opaque;
-    CPUARMState *env = &cpu->env;
 
-    return arm_feature(env, ARM_FEATURE_SVE);
+    return cpu_isar_feature(aa64_sve, cpu);
 }
 
 /* The first two words of each Zreg is stored in VFP state.  */
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ void aarch64_cpu_dump_state(CPUState *cs, FILE *f,
     cpu_fprintf(f, "     FPCR=%08x FPSR=%08x\n",
                 vfp_get_fpcr(env), vfp_get_fpsr(env));
 
-    if (arm_feature(env, ARM_FEATURE_SVE) && sve_exception_el(env, el) == 0) {
+    if (cpu_isar_feature(aa64_sve, cpu) && sve_exception_el(env, el) == 0) {
         int j, zcr_len = sve_zcr_len_for_el(env, el);
 
         for (i = 0; i <= FFR_PRED_NUM; i++) {
@@ -XXX,XX +XXX,XX @@ static void disas_a64_insn(CPUARMState *env, DisasContext *s)
         unallocated_encoding(s);
         break;
     case 0x2:
-        if (!arm_dc_feature(s, ARM_FEATURE_SVE) || !disas_sve(s, insn)) {
+        if (!dc_isar_feature(aa64_sve, s) || !disas_sve(s, insn)) {
             unallocated_encoding(s);
         }
         break;
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181016223115.24100-9-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h           | 17 +++++++++++++++-
 linux-user/elfload.c       |  6 +-----
 target/arm/cpu64.c         | 16 ++++++++-------
 target/arm/helper.c        |  2 +-
 target/arm/translate-a64.c | 40 +++++++++++++++++++-------------------
 target/arm/translate.c     |  6 +++---
 6 files changed, 50 insertions(+), 37 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ enum arm_features {
     ARM_FEATURE_PMU, /* has PMU support */
     ARM_FEATURE_VBAR, /* has cp15 VBAR */
     ARM_FEATURE_M_SECURITY, /* M profile Security Extension */
-    ARM_FEATURE_V8_FP16, /* implements v8.2 half-precision float */
     ARM_FEATURE_M_MAIN, /* M profile Main Extension */
 };
 
@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_aa32_dp(const ARMISARegisters *id)
     return FIELD_EX32(id->id_isar6, ID_ISAR6, DP) != 0;
 }
 
+static inline bool isar_feature_aa32_fp16_arith(const ARMISARegisters *id)
+{
+    /*
+     * This is a placeholder for use by VCMA until the rest of
+     * the ARMv8.2-FP16 extension is implemented for aa32 mode.
+     * At which point we can properly set and check MVFR1.FPHP.
+     */
+    return FIELD_EX64(id->id_aa64pfr0, ID_AA64PFR0, FP) == 1;
+}
+
 /*
  * 64-bit feature tests via id registers.
  */
@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_aa64_fcma(const ARMISARegisters *id)
     return FIELD_EX64(id->id_aa64isar1, ID_AA64ISAR1, FCMA) != 0;
 }
 
+static inline bool isar_feature_aa64_fp16(const ARMISARegisters *id)
+{
+    /* We always set the AdvSIMD and FP fields identically wrt FP16.  */
+    return FIELD_EX64(id->id_aa64pfr0, ID_AA64PFR0, FP) == 1;
+}
+
 static inline bool isar_feature_aa64_sve(const ARMISARegisters *id)
 {
     return FIELD_EX64(id->id_aa64pfr0, ID_AA64PFR0, SVE) != 0;
diff --git a/linux-user/elfload.c b/linux-user/elfload.c
index XXXXXXX..XXXXXXX 100644
--- a/linux-user/elfload.c
+++ b/linux-user/elfload.c
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
     hwcaps |= ARM_HWCAP_A64_ASIMD;
 
     /* probe for the extra features */
-#define GET_FEATURE(feat, hwcap) \
-    do { if (arm_feature(&cpu->env, feat)) { hwcaps |= hwcap; } } while (0)
 #define GET_FEATURE_ID(feat, hwcap) \
     do { if (cpu_isar_feature(feat, cpu)) { hwcaps |= hwcap; } } while (0)
 
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
     GET_FEATURE_ID(aa64_sha3, ARM_HWCAP_A64_SHA3);
     GET_FEATURE_ID(aa64_sm3, ARM_HWCAP_A64_SM3);
     GET_FEATURE_ID(aa64_sm4, ARM_HWCAP_A64_SM4);
-    GET_FEATURE(ARM_FEATURE_V8_FP16,
-                ARM_HWCAP_A64_FPHP | ARM_HWCAP_A64_ASIMDHP);
+    GET_FEATURE_ID(aa64_fp16, ARM_HWCAP_A64_FPHP | ARM_HWCAP_A64_ASIMDHP);
     GET_FEATURE_ID(aa64_atomics, ARM_HWCAP_A64_ATOMICS);
     GET_FEATURE_ID(aa64_rdm, ARM_HWCAP_A64_ASIMDRDM);
     GET_FEATURE_ID(aa64_dp, ARM_HWCAP_A64_ASIMDDP);
     GET_FEATURE_ID(aa64_fcma, ARM_HWCAP_A64_FCMA);
     GET_FEATURE_ID(aa64_sve, ARM_HWCAP_A64_SVE);
 
-#undef GET_FEATURE
 #undef GET_FEATURE_ID
 
     return hwcaps;
diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu64.c
+++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
 
         t = cpu->isar.id_aa64pfr0;
         t = FIELD_DP64(t, ID_AA64PFR0, SVE, 1);
+        t = FIELD_DP64(t, ID_AA64PFR0, FP, 1);
+        t = FIELD_DP64(t, ID_AA64PFR0, ADVSIMD, 1);
         cpu->isar.id_aa64pfr0 = t;
 
         /* Replicate the same data to the 32-bit id registers.  */
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
         u = FIELD_DP32(u, ID_ISAR6, DP, 1);
         cpu->isar.id_isar6 = u;
 
-#ifdef CONFIG_USER_ONLY
-        /* We don't set these in system emulation mode for the moment,
-         * since we don't correctly set the ID registers to advertise them,
-         * and in some cases they're only available in AArch64 and not AArch32,
-         * whereas the architecture requires them to be present in both if
-         * present in either.
+        /*
+         * FIXME: We do not yet support ARMv8.2-fp16 for AArch32 yet,
+         * so do not set MVFR1.FPHP.  Strictly speaking this is not legal,
+         * but it is also not legal to enable SVE without support for FP16,
+         * and enabling SVE in system mode is more useful in the short term.
          */
-        set_feature(&cpu->env, ARM_FEATURE_V8_FP16);
+
+#ifdef CONFIG_USER_ONLY
         /* For usermode -cpu max we can use a larger and more efficient DCZ
          * blocksize since we don't have to follow what the hardware does.
          */
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(vfp_set_fpscr)(CPUARMState *env, uint32_t val)
     uint32_t changed;
 
     /* When ARMv8.2-FP16 is not supported, FZ16 is RES0.  */
-    if (!arm_feature(env, ARM_FEATURE_V8_FP16)) {
+    if (!cpu_isar_feature(aa64_fp16, arm_env_get_cpu(env))) {
         val &= ~FPCR_FZ16;
     }
 
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_fp_compare(DisasContext *s, uint32_t insn)
         break;
     case 3:
         size = MO_16;
-        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (dc_isar_feature(aa64_fp16, s)) {
             break;
         }
         /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_ccomp(DisasContext *s, uint32_t insn)
         break;
     case 3:
         size = MO_16;
-        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (dc_isar_feature(aa64_fp16, s)) {
             break;
         }
         /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_csel(DisasContext *s, uint32_t insn)
         break;
     case 3:
         sz = MO_16;
-        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (dc_isar_feature(aa64_fp16, s)) {
             break;
         }
         /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_1src(DisasContext *s, uint32_t insn)
             handle_fp_1src_double(s, opcode, rd, rn);
             break;
         case 3:
-            if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+            if (!dc_isar_feature(aa64_fp16, s)) {
                 unallocated_encoding(s);
                 return;
             }
@@ -XXX,XX +XXX,XX @@ static void disas_fp_2src(DisasContext *s, uint32_t insn)
         handle_fp_2src_double(s, opcode, rd, rn, rm);
         break;
     case 3:
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (!dc_isar_feature(aa64_fp16, s)) {
             unallocated_encoding(s);
             return;
         }
@@ -XXX,XX +XXX,XX @@ static void disas_fp_3src(DisasContext *s, uint32_t insn)
         handle_fp_3src_double(s, o0, o1, rd, rn, rm, ra);
         break;
     case 3:
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (!dc_isar_feature(aa64_fp16, s)) {
             unallocated_encoding(s);
             return;
         }
@@ -XXX,XX +XXX,XX @@ static void disas_fp_imm(DisasContext *s, uint32_t insn)
         break;
     case 3:
         sz = MO_16;
-        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (dc_isar_feature(aa64_fp16, s)) {
             break;
         }
         /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_fixed_conv(DisasContext *s, uint32_t insn)
     case 1: /* float64 */
         break;
     case 3: /* float16 */
-        if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (dc_isar_feature(aa64_fp16, s)) {
             break;
         }
         /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_int_conv(DisasContext *s, uint32_t insn)
             break;
         case 0x6: /* 16-bit float, 32-bit int */
         case 0xe: /* 16-bit float, 64-bit int */
-            if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+            if (dc_isar_feature(aa64_fp16, s)) {
                 break;
             }
             /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_fp_int_conv(DisasContext *s, uint32_t insn)
         case 1: /* float64 */
             break;
         case 3: /* float16 */
-            if (arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+            if (dc_isar_feature(aa64_fp16, s)) {
                 break;
             }
             /* fallthru */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_across_lanes(DisasContext *s, uint32_t insn)
          */
         is_min = extract32(size, 1, 1);
         is_fp = true;
-        if (!is_u && arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (!is_u && dc_isar_feature(aa64_fp16, s)) {
             size = 1;
         } else if (!is_u || !is_q || extract32(size, 0, 1)) {
             unallocated_encoding(s);
@@ -XXX,XX +XXX,XX @@ static void disas_simd_mod_imm(DisasContext *s, uint32_t insn)
 
     if (o2 != 0 || ((cmode == 0xf) && is_neg && !is_q)) {
         /* Check for FMOV (vector, immediate) - half-precision */
-        if (!(arm_dc_feature(s, ARM_FEATURE_V8_FP16) && o2 && cmode == 0xf)) {
+        if (!(dc_isar_feature(aa64_fp16, s) && o2 && cmode == 0xf)) {
             unallocated_encoding(s);
             return;
         }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_pairwise(DisasContext *s, uint32_t insn)
     case 0x2f: /* FMINP */
         /* FP op, size[0] is 32 or 64 bit*/
         if (!u) {
-            if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+            if (!dc_isar_feature(aa64_fp16, s)) {
                 unallocated_encoding(s);
                 return;
             } else {
@@ -XXX,XX +XXX,XX @@ static void handle_simd_shift_intfp_conv(DisasContext *s, bool is_scalar,
         size = MO_32;
     } else if (immh & 2) {
         size = MO_16;
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (!dc_isar_feature(aa64_fp16, s)) {
             unallocated_encoding(s);
             return;
         }
@@ -XXX,XX +XXX,XX @@ static void handle_simd_shift_fpint_conv(DisasContext *s, bool is_scalar,
         size = MO_32;
     } else if (immh & 0x2) {
         size = MO_16;
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+        if (!dc_isar_feature(aa64_fp16, s)) {
             unallocated_encoding(s);
             return;
         }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_three_reg_same_fp16(DisasContext *s,
         return;
     }
 
-    if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+    if (!dc_isar_feature(aa64_fp16, s)) {
         unallocated_encoding(s);
     }
 
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_fp16(DisasContext *s, uint32_t insn)
     TCGv_ptr fpst;
     bool pairwise = false;
 
-    if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+    if (!dc_isar_feature(aa64_fp16, s)) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
     case 0x1c: /* FCADD, #90 */
     case 0x1e: /* FCADD, #270 */
         if (size == 0
-            || (size == 1 && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))
+            || (size == 1 && !dc_isar_feature(aa64_fp16, s))
             || (size == 3 && !is_q)) {
             unallocated_encoding(s);
             return;
@@ -XXX,XX +XXX,XX @@ static void disas_simd_two_reg_misc_fp16(DisasContext *s, uint32_t insn)
     bool need_fpst = true;
     int rmode;
 
-    if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+    if (!dc_isar_feature(aa64_fp16, s)) {
         unallocated_encoding(s);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
         }
         break;
     }
-    if (is_fp16 && !arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+    if (is_fp16 && !dc_isar_feature(aa64_fp16, s)) {
         unallocated_encoding(s);
         return;
     }
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
         int size = extract32(insn, 20, 1);
         data = extract32(insn, 23, 2); /* rot */
         if (!dc_isar_feature(aa32_vcma, s)
-            || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
+            || (!size && !dc_isar_feature(aa32_fp16_arith, s))) {
             return 1;
         }
         fn_gvec_ptr = size ? gen_helper_gvec_fcmlas : gen_helper_gvec_fcmlah;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
         int size = extract32(insn, 20, 1);
         data = extract32(insn, 24, 1); /* rot */
         if (!dc_isar_feature(aa32_vcma, s)
-            || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
+            || (!size && !dc_isar_feature(aa32_fp16_arith, s))) {
             return 1;
         }
         fn_gvec_ptr = size ? gen_helper_gvec_fcadds : gen_helper_gvec_fcaddh;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
             return 1;
         }
         if (size == 0) {
-            if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+            if (!dc_isar_feature(aa32_fp16_arith, s)) {
                 return 1;
             }
             /* For fp16, rm is just Vm, and index is M.  */
-- 
2.19.1

For AArch32, exception return happens through certain kinds
of CPSR write. We don't currently have any CPU_LOG_INT logging
of these events (unlike AArch64, where we log in the ERET
instruction). Add some suitable logging.

This will log exception returns like this:
Exception return from AArch32 hyp to usr PC 0x80100374

paralleling the existing logging in the exception_return
helper for AArch64 exception returns:
Exception return from AArch64 EL2 to AArch64 EL0 PC 0x8003045c
Exception return from AArch64 EL2 to AArch32 EL0 PC 0x8003045c

(Note that an AArch32 exception return can only be
AArch32->AArch32, never to AArch64.)

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-2-peter.maydell@linaro.org
---
 target/arm/internals.h | 18 ++++++++++++++++++
 target/arm/helper.c    | 10 ++++++++++
 target/arm/translate.c |  7 +------
 3 files changed, 29 insertions(+), 6 deletions(-)

diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ static inline uint32_t v7m_sp_limit(CPUARMState *env)
     }
 }
 
+/**
+ * aarch32_mode_name(): Return name of the AArch32 CPU mode
+ * @psr: Program Status Register indicating CPU mode
+ *
+ * Returns, for debug logging purposes, a printable representation
+ * of the AArch32 CPU mode ("svc", "usr", etc) as indicated by
+ * the low bits of the specified PSR.
+ */
+static inline const char *aarch32_mode_name(uint32_t psr)
+{
+    static const char cpu_mode_names[16][4] = {
+        "usr", "fiq", "irq", "svc", "???", "???", "mon", "abt",
+        "???", "???", "hyp", "und", "???", "???", "???", "sys"
+    };
+
+    return cpu_mode_names[psr & 0xf];
+}
+
 #endif
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void cpsr_write(CPUARMState *env, uint32_t val, uint32_t mask,
                 mask |= CPSR_IL;
                 val |= CPSR_IL;
             }
+            qemu_log_mask(LOG_GUEST_ERROR,
+                          "Illegal AArch32 mode switch attempt from %s to %s\n",
+                          aarch32_mode_name(env->uncached_cpsr),
+                          aarch32_mode_name(val));
         } else {
+            qemu_log_mask(CPU_LOG_INT, "%s %s to %s PC 0x%" PRIx32 "\n",
+                          write_type == CPSRWriteExceptionReturn ?
+                          "Exception return from AArch32" :
+                          "AArch32 mode switch from",
+                          aarch32_mode_name(env->uncached_cpsr),
+                          aarch32_mode_name(val), env->regs[15]);
             switch_mode(env, val & CPSR_M);
         }
     }
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ void gen_intermediate_code(CPUState *cpu, TranslationBlock *tb)
     translator_loop(ops, &dc.base, cpu, tb);
 }
 
-static const char *cpu_mode_names[16] = {
-  "usr", "fiq", "irq", "svc", "???", "???", "mon", "abt",
-  "???", "???", "hyp", "und", "???", "???", "???", "sys"
-};
-
 void arm_cpu_dump_state(CPUState *cs, FILE *f, fprintf_function cpu_fprintf,
                         int flags)
 {
@@ -XXX,XX +XXX,XX @@ void arm_cpu_dump_state(CPUState *cs, FILE *f, fprintf_function cpu_fprintf,
                     psr & CPSR_V ? 'V' : '-',
                     psr & CPSR_T ? 'T' : 'A',
                     ns_status,
-                    cpu_mode_names[psr & 0xf], (psr & 0x10) ? 32 : 26);
+                    aarch32_mode_name(psr), (psr & 0x10) ? 32 : 26);
     }
 
     if (flags & CPU_DUMP_FPU) {
-- 
2.19.1

The switch_mode() function is defined in target/arm/helper.c and used
only in that file and nowhere else, so we can make it file-local
rather than global.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-3-peter.maydell@linaro.org
---
 target/arm/internals.h | 1 -
 target/arm/helper.c    | 6 ++++--
 2 files changed, 4 insertions(+), 3 deletions(-)

diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ static inline int bank_number(int mode)
     g_assert_not_reached();
 }
 
-void switch_mode(CPUARMState *, int);
 void arm_cpu_register_gdb_regs_for_features(ARMCPU *cpu);
 void arm_translate_init(void);
 
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void v8m_security_lookup(CPUARMState *env, uint32_t address,
                                 V8M_SAttributes *sattrs);
 #endif
 
+static void switch_mode(CPUARMState *env, int mode);
+
 static int vfp_gdb_get_reg(CPUARMState *env, uint8_t *buf, int reg)
 {
     int nregs;
@@ -XXX,XX +XXX,XX @@ uint32_t HELPER(v7m_tt)(CPUARMState *env, uint32_t addr, uint32_t op)
     return 0;
 }
 
-void switch_mode(CPUARMState *env, int mode)
+static void switch_mode(CPUARMState *env, int mode)
 {
     ARMCPU *cpu = arm_env_get_cpu(env);
 
@@ -XXX,XX +XXX,XX @@ void aarch64_sync_64_to_32(CPUARMState *env)
 
 #else
 
-void switch_mode(CPUARMState *env, int mode)
+static void switch_mode(CPUARMState *env, int mode)
 {
     int old_mode;
     int i;
-- 
2.19.1

The HCR.FB virtualization configuration register bit requests that
TLB maintenance, branch predictor invalidate-all and icache
invalidate-all operations performed in NS EL1 should be upgraded
from "local CPU only to "broadcast within Inner Shareable domain".
For QEMU we NOP the branch predictor and icache operations, so
we only need to upgrade the TLB invalidates:
 AArch32 TLBIALL, TLBIMVA, TLBIASID, DTLBIALL, DTLBIMVA, DTLBIASID,
         ITLBIALL, ITLBIMVA, ITLBIASID, TLBIMVAA, TLBIMVAL, TLBIMVAAL
 AArch64 TLBI VMALLE1, TLBI VAE1, TLBI ASIDE1, TLBI VAAE1,
         TLBI VALE1, TLBI VAALE1

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-4-peter.maydell@linaro.org
---
 target/arm/helper.c | 191 +++++++++++++++++++++++++++-----------------
 1 file changed, 116 insertions(+), 75 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void contextidr_write(CPUARMState *env, const ARMCPRegInfo *ri,
     raw_write(env, ri, value);
 }
 
-static void tlbiall_write(CPUARMState *env, const ARMCPRegInfo *ri,
-                          uint64_t value)
-{
-    /* Invalidate all (TLBIALL) */
-    ARMCPU *cpu = arm_env_get_cpu(env);
-
-    tlb_flush(CPU(cpu));
-}
-
-static void tlbimva_write(CPUARMState *env, const ARMCPRegInfo *ri,
-                          uint64_t value)
-{
-    /* Invalidate single TLB entry by MVA and ASID (TLBIMVA) */
-    ARMCPU *cpu = arm_env_get_cpu(env);
-
-    tlb_flush_page(CPU(cpu), value & TARGET_PAGE_MASK);
-}
-
-static void tlbiasid_write(CPUARMState *env, const ARMCPRegInfo *ri,
-                           uint64_t value)
-{
-    /* Invalidate by ASID (TLBIASID) */
-    ARMCPU *cpu = arm_env_get_cpu(env);
-
-    tlb_flush(CPU(cpu));
-}
-
-static void tlbimvaa_write(CPUARMState *env, const ARMCPRegInfo *ri,
-                           uint64_t value)
-{
-    /* Invalidate single entry by MVA, all ASIDs (TLBIMVAA) */
-    ARMCPU *cpu = arm_env_get_cpu(env);
-
-    tlb_flush_page(CPU(cpu), value & TARGET_PAGE_MASK);
-}
-
 /* IS variants of TLB operations must affect all cores */
 static void tlbiall_is_write(CPUARMState *env, const ARMCPRegInfo *ri,
                              uint64_t value)
@@ -XXX,XX +XXX,XX @@ static void tlbimvaa_is_write(CPUARMState *env, const ARMCPRegInfo *ri,
     tlb_flush_page_all_cpus_synced(cs, value & TARGET_PAGE_MASK);
 }
 
+/*
+ * Non-IS variants of TLB operations are upgraded to
+ * IS versions if we are at NS EL1 and HCR_EL2.FB is set to
+ * force broadcast of these operations.
+ */
+static bool tlb_force_broadcast(CPUARMState *env)
+{
+    return (env->cp15.hcr_el2 & HCR_FB) &&
+        arm_current_el(env) == 1 && arm_is_secure_below_el3(env);
+}
+
+static void tlbiall_write(CPUARMState *env, const ARMCPRegInfo *ri,
+                          uint64_t value)
+{
+    /* Invalidate all (TLBIALL) */
+    ARMCPU *cpu = arm_env_get_cpu(env);
+
+    if (tlb_force_broadcast(env)) {
+        tlbiall_is_write(env, NULL, value);
+        return;
+    }
+
+    tlb_flush(CPU(cpu));
+}
+
+static void tlbimva_write(CPUARMState *env, const ARMCPRegInfo *ri,
+                          uint64_t value)
+{
+    /* Invalidate single TLB entry by MVA and ASID (TLBIMVA) */
+    ARMCPU *cpu = arm_env_get_cpu(env);
+
+    if (tlb_force_broadcast(env)) {
+        tlbimva_is_write(env, NULL, value);
+        return;
+    }
+
+    tlb_flush_page(CPU(cpu), value & TARGET_PAGE_MASK);
+}
+
+static void tlbiasid_write(CPUARMState *env, const ARMCPRegInfo *ri,
+                           uint64_t value)
+{
+    /* Invalidate by ASID (TLBIASID) */
+    ARMCPU *cpu = arm_env_get_cpu(env);
+
+    if (tlb_force_broadcast(env)) {
+        tlbiasid_is_write(env, NULL, value);
+        return;
+    }
+
+    tlb_flush(CPU(cpu));
+}
+
+static void tlbimvaa_write(CPUARMState *env, const ARMCPRegInfo *ri,
+                           uint64_t value)
+{
+    /* Invalidate single entry by MVA, all ASIDs (TLBIMVAA) */
+    ARMCPU *cpu = arm_env_get_cpu(env);
+
+    if (tlb_force_broadcast(env)) {
+        tlbimvaa_is_write(env, NULL, value);
+        return;
+    }
+
+    tlb_flush_page(CPU(cpu), value & TARGET_PAGE_MASK);
+}
+
 static void tlbiall_nsnh_write(CPUARMState *env, const ARMCPRegInfo *ri,
                                uint64_t value)
 {
@@ -XXX,XX +XXX,XX @@ static CPAccessResult aa64_cacheop_access(CPUARMState *env,
  * Page D4-1736 (DDI0487A.b)
  */
 
-static void tlbi_aa64_vmalle1_write(CPUARMState *env, const ARMCPRegInfo *ri,
-                                    uint64_t value)
-{
-    CPUState *cs = ENV_GET_CPU(env);
-
-    if (arm_is_secure_below_el3(env)) {
-        tlb_flush_by_mmuidx(cs,
-                            ARMMMUIdxBit_S1SE1 |
-                            ARMMMUIdxBit_S1SE0);
-    } else {
-        tlb_flush_by_mmuidx(cs,
-                            ARMMMUIdxBit_S12NSE1 |
-                            ARMMMUIdxBit_S12NSE0);
-    }
-}
-
 static void tlbi_aa64_vmalle1is_write(CPUARMState *env, const ARMCPRegInfo *ri,
                                       uint64_t value)
 {
@@ -XXX,XX +XXX,XX @@ static void tlbi_aa64_vmalle1is_write(CPUARMState *env, const ARMCPRegInfo *ri,
     }
 }
 
+static void tlbi_aa64_vmalle1_write(CPUARMState *env, const ARMCPRegInfo *ri,
+                                    uint64_t value)
+{
+    CPUState *cs = ENV_GET_CPU(env);
+
+    if (tlb_force_broadcast(env)) {
+        tlbi_aa64_vmalle1_write(env, NULL, value);
+        return;
+    }
+
+    if (arm_is_secure_below_el3(env)) {
+        tlb_flush_by_mmuidx(cs,
+                            ARMMMUIdxBit_S1SE1 |
+                            ARMMMUIdxBit_S1SE0);
+    } else {
+        tlb_flush_by_mmuidx(cs,
+                            ARMMMUIdxBit_S12NSE1 |
+                            ARMMMUIdxBit_S12NSE0);
+    }
+}
+
 static void tlbi_aa64_alle1_write(CPUARMState *env, const ARMCPRegInfo *ri,
                                   uint64_t value)
 {
@@ -XXX,XX +XXX,XX @@ static void tlbi_aa64_alle3is_write(CPUARMState *env, const ARMCPRegInfo *ri,
     tlb_flush_by_mmuidx_all_cpus_synced(cs, ARMMMUIdxBit_S1E3);
 }
 
-static void tlbi_aa64_vae1_write(CPUARMState *env, const ARMCPRegInfo *ri,
-                                 uint64_t value)
-{
-    /* Invalidate by VA, EL1&0 (AArch64 version).
-     * Currently handles all of VAE1, VAAE1, VAALE1 and VALE1,
-     * since we don't support flush-for-specific-ASID-only or
-     * flush-last-level-only.
-     */
-    ARMCPU *cpu = arm_env_get_cpu(env);
-    CPUState *cs = CPU(cpu);
-    uint64_t pageaddr = sextract64(value << 12, 0, 56);
-
-    if (arm_is_secure_below_el3(env)) {
-        tlb_flush_page_by_mmuidx(cs, pageaddr,
-                                 ARMMMUIdxBit_S1SE1 |
-                                 ARMMMUIdxBit_S1SE0);
-    } else {
-        tlb_flush_page_by_mmuidx(cs, pageaddr,
-                                 ARMMMUIdxBit_S12NSE1 |
-                                 ARMMMUIdxBit_S12NSE0);
-    }
-}
-
 static void tlbi_aa64_vae2_write(CPUARMState *env, const ARMCPRegInfo *ri,
                                  uint64_t value)
 {
@@ -XXX,XX +XXX,XX @@ static void tlbi_aa64_vae1is_write(CPUARMState *env, const ARMCPRegInfo *ri,
     }
 }
 
+static void tlbi_aa64_vae1_write(CPUARMState *env, const ARMCPRegInfo *ri,
+                                 uint64_t value)
+{
+    /* Invalidate by VA, EL1&0 (AArch64 version).
+     * Currently handles all of VAE1, VAAE1, VAALE1 and VALE1,
+     * since we don't support flush-for-specific-ASID-only or
+     * flush-last-level-only.
+     */
+    ARMCPU *cpu = arm_env_get_cpu(env);
+    CPUState *cs = CPU(cpu);
+    uint64_t pageaddr = sextract64(value << 12, 0, 56);
+
+    if (tlb_force_broadcast(env)) {
+        tlbi_aa64_vae1is_write(env, NULL, value);
+        return;
+    }
+
+    if (arm_is_secure_below_el3(env)) {
+        tlb_flush_page_by_mmuidx(cs, pageaddr,
+                                 ARMMMUIdxBit_S1SE1 |
+                                 ARMMMUIdxBit_S1SE0);
+    } else {
+        tlb_flush_page_by_mmuidx(cs, pageaddr,
+                                 ARMMMUIdxBit_S12NSE1 |
+                                 ARMMMUIdxBit_S12NSE0);
+    }
+}
+
 static void tlbi_aa64_vae2is_write(CPUARMState *env, const ARMCPRegInfo *ri,
                                    uint64_t value)
 {
-- 
2.19.1

The HCR.DC virtualization configuration register bit has the
following effects:
 * SCTLR.M behaves as if it is 0 for all purposes except
   direct reads of the bit
 * HCR.VM behaves as if it is 1 for all purposes except
   direct reads of the bit
 * the memory type produced by the first stage of the EL1&EL0
   translation regime is Normal Non-Shareable,
   Inner Write-Back Read-Allocate Write-Allocate,
   Outer Write-Back Read-Allocate Write-Allocate.

Implement this behaviour.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-5-peter.maydell@linaro.org
---
 target/arm/helper.c | 23 +++++++++++++++++++++--
 1 file changed, 21 insertions(+), 2 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static uint64_t do_ats_write(CPUARMState *env, uint64_t value,
          * * The Non-secure TTBCR.EAE bit is set to 1
          * * The implementation includes EL2, and the value of HCR.VM is 1
          *
+         * (Note that HCR.DC makes HCR.VM behave as if it is 1.)
+         *
          * ATS1Hx always uses the 64bit format (not supported yet).
          */
         format64 = arm_s1_regime_using_lpae_format(env, mmu_idx);
 
         if (arm_feature(env, ARM_FEATURE_EL2)) {
             if (mmu_idx == ARMMMUIdx_S12NSE0 || mmu_idx == ARMMMUIdx_S12NSE1) {
-                format64 |= env->cp15.hcr_el2 & HCR_VM;
+                format64 |= env->cp15.hcr_el2 & (HCR_VM | HCR_DC);
             } else {
                 format64 |= arm_current_el(env) == 2;
             }
@@ -XXX,XX +XXX,XX @@ static inline bool regime_translation_disabled(CPUARMState *env,
     }
 
     if (mmu_idx == ARMMMUIdx_S2NS) {
-        return (env->cp15.hcr_el2 & HCR_VM) == 0;
+        /* HCR.DC means HCR.VM behaves as 1 */
+        return (env->cp15.hcr_el2 & (HCR_DC | HCR_VM)) == 0;
     }
 
     if (env->cp15.hcr_el2 & HCR_TGE) {
@@ -XXX,XX +XXX,XX @@ static inline bool regime_translation_disabled(CPUARMState *env,
         }
     }
 
+    if ((env->cp15.hcr_el2 & HCR_DC) &&
+        (mmu_idx == ARMMMUIdx_S1NSE0 || mmu_idx == ARMMMUIdx_S1NSE1)) {
+        /* HCR.DC means SCTLR_EL1.M behaves as 0 */
+        return true;
+    }
+
     return (regime_sctlr(env, mmu_idx) & SCTLR_M) == 0;
 }
 
@@ -XXX,XX +XXX,XX @@ static bool get_phys_addr(CPUARMState *env, target_ulong address,
 
             /* Combine the S1 and S2 cache attributes, if needed */
             if (!ret && cacheattrs != NULL) {
+                if (env->cp15.hcr_el2 & HCR_DC) {
+                    /*
+                     * HCR.DC forces the first stage attributes to
+                     *  Normal Non-Shareable,
+                     *  Inner Write-Back Read-Allocate Write-Allocate,
+                     *  Outer Write-Back Read-Allocate Write-Allocate.
+                     */
+                    cacheattrs->attrs = 0xff;
+                    cacheattrs->shareability = 0;
+                }
                 *cacheattrs = combine_cacheattrs(*cacheattrs, cacheattrs2);
             }
 
-- 
2.19.1

The A/I/F bits in ISR_EL1 should track the virtual interrupt
status, not the physical interrupt status, if the associated
HCR_EL2.AMO/IMO/FMO bit is set. Implement this, rather than
always showing the physical interrupt status.

We don't currently implement anything to do with external
aborts, so this applies only to the I and F bits (though it
ought to be possible for the outer guest to present a virtual
external abort to the inner guest, even if QEMU doesn't
emulate physical external aborts, so there is missing
functionality in this area).

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-6-peter.maydell@linaro.org
---
 target/arm/helper.c | 22 ++++++++++++++++++----
 1 file changed, 18 insertions(+), 4 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static uint64_t isr_read(CPUARMState *env, const ARMCPRegInfo *ri)
     CPUState *cs = ENV_GET_CPU(env);
     uint64_t ret = 0;
 
-    if (cs->interrupt_request & CPU_INTERRUPT_HARD) {
-        ret |= CPSR_I;
+    if (arm_hcr_el2_imo(env)) {
+        if (cs->interrupt_request & CPU_INTERRUPT_VIRQ) {
+            ret |= CPSR_I;
+        }
+    } else {
+        if (cs->interrupt_request & CPU_INTERRUPT_HARD) {
+            ret |= CPSR_I;
+        }
     }
-    if (cs->interrupt_request & CPU_INTERRUPT_FIQ) {
-        ret |= CPSR_F;
+
+    if (arm_hcr_el2_fmo(env)) {
+        if (cs->interrupt_request & CPU_INTERRUPT_VFIQ) {
+            ret |= CPSR_F;
+        }
+    } else {
+        if (cs->interrupt_request & CPU_INTERRUPT_FIQ) {
+            ret |= CPSR_F;
+        }
     }
+
     /* External aborts are not possible in QEMU so A bit is always clear */
     return ret;
 }
-- 
2.19.1

The HCR_EL2 VI and VF bits are supposed to track whether there is
a pending virtual IRQ or virtual FIQ. For QEMU we store the
pending VIRQ/VFIQ status in cs->interrupt_request, so this means:
 * if the register is read we must get these bit values from
   cs->interrupt_request
 * if the register is written then we must write the bit
   values back into cs->interrupt_request

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-7-peter.maydell@linaro.org
---
 target/arm/helper.c | 47 +++++++++++++++++++++++++++++++++++++++++----
 1 file changed, 43 insertions(+), 4 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo el3_no_el2_v8_cp_reginfo[] = {
 static void hcr_write(CPUARMState *env, const ARMCPRegInfo *ri, uint64_t value)
 {
     ARMCPU *cpu = arm_env_get_cpu(env);
+    CPUState *cs = ENV_GET_CPU(env);
     uint64_t valid_mask = HCR_MASK;
 
     if (arm_feature(env, ARM_FEATURE_EL3)) {
@@ -XXX,XX +XXX,XX @@ static void hcr_write(CPUARMState *env, const ARMCPRegInfo *ri, uint64_t value)
     /* Clear RES0 bits.  */
     value &= valid_mask;
 
+    /*
+     * VI and VF are kept in cs->interrupt_request. Modifying that
+     * requires that we have the iothread lock, which is done by
+     * marking the reginfo structs as ARM_CP_IO.
+     * Note that if a write to HCR pends a VIRQ or VFIQ it is never
+     * possible for it to be taken immediately, because VIRQ and
+     * VFIQ are masked unless running at EL0 or EL1, and HCR
+     * can only be written at EL2.
+     */
+    g_assert(qemu_mutex_iothread_locked());
+    if (value & HCR_VI) {
+        cs->interrupt_request |= CPU_INTERRUPT_VIRQ;
+    } else {
+        cs->interrupt_request &= ~CPU_INTERRUPT_VIRQ;
+    }
+    if (value & HCR_VF) {
+        cs->interrupt_request |= CPU_INTERRUPT_VFIQ;
+    } else {
+        cs->interrupt_request &= ~CPU_INTERRUPT_VFIQ;
+    }
+    value &= ~(HCR_VI | HCR_VF);
+
     /* These bits change the MMU setup:
      * HCR_VM enables stage 2 translation
      * HCR_PTW forbids certain page-table setups
@@ -XXX,XX +XXX,XX @@ static void hcr_writelow(CPUARMState *env, const ARMCPRegInfo *ri,
     hcr_write(env, NULL, value);
 }
 
+static uint64_t hcr_read(CPUARMState *env, const ARMCPRegInfo *ri)
+{
+    /* The VI and VF bits live in cs->interrupt_request */
+    uint64_t ret = env->cp15.hcr_el2 & ~(HCR_VI | HCR_VF);
+    CPUState *cs = ENV_GET_CPU(env);
+
+    if (cs->interrupt_request & CPU_INTERRUPT_VIRQ) {
+        ret |= HCR_VI;
+    }
+    if (cs->interrupt_request & CPU_INTERRUPT_VFIQ) {
+        ret |= HCR_VF;
+    }
+    return ret;
+}
+
 static const ARMCPRegInfo el2_cp_reginfo[] = {
     { .name = "HCR_EL2", .state = ARM_CP_STATE_AA64,
+      .type = ARM_CP_IO,
       .opc0 = 3, .opc1 = 4, .crn = 1, .crm = 1, .opc2 = 0,
       .access = PL2_RW, .fieldoffset = offsetof(CPUARMState, cp15.hcr_el2),
-      .writefn = hcr_write },
+      .writefn = hcr_write, .readfn = hcr_read },
     { .name = "HCR", .state = ARM_CP_STATE_AA32,
-      .type = ARM_CP_ALIAS,
+      .type = ARM_CP_ALIAS | ARM_CP_IO,
       .cp = 15, .opc1 = 4, .crn = 1, .crm = 1, .opc2 = 0,
       .access = PL2_RW, .fieldoffset = offsetof(CPUARMState, cp15.hcr_el2),
-      .writefn = hcr_writelow },
+      .writefn = hcr_writelow, .readfn = hcr_read },
     { .name = "ELR_EL2", .state = ARM_CP_STATE_AA64,
       .type = ARM_CP_ALIAS,
       .opc0 = 3, .opc1 = 4, .crn = 4, .crm = 0, .opc2 = 1,
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo el2_cp_reginfo[] = {
 
 static const ARMCPRegInfo el2_v8_cp_reginfo[] = {
     { .name = "HCR2", .state = ARM_CP_STATE_AA32,
-      .type = ARM_CP_ALIAS,
+      .type = ARM_CP_ALIAS | ARM_CP_IO,
       .cp = 15, .opc1 = 4, .crn = 1, .crm = 1, .opc2 = 4,
       .access = PL2_RW,
       .fieldoffset = offsetofhigh32(CPUARMState, cp15.hcr_el2),
-- 
2.19.1

If the HCR_EL2 PTW virtualizaiton configuration register bit
is set, then this means that a stage 2 Permission fault must
be generated if a stage 1 translation table access is made
to an address that is mapped as Device memory in stage 2.
Implement this.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-8-peter.maydell@linaro.org
---
 target/arm/helper.c | 21 ++++++++++++++++++++-
 1 file changed, 20 insertions(+), 1 deletion(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static hwaddr S1_ptw_translate(CPUARMState *env, ARMMMUIdx mmu_idx,
         hwaddr s2pa;
         int s2prot;
         int ret;
+        ARMCacheAttrs cacheattrs = {};
+        ARMCacheAttrs *pcacheattrs = NULL;
+
+        if (env->cp15.hcr_el2 & HCR_PTW) {
+            /*
+             * PTW means we must fault if this S1 walk touches S2 Device
+             * memory; otherwise we don't care about the attributes and can
+             * save the S2 translation the effort of computing them.
+             */
+            pcacheattrs = &cacheattrs;
+        }
 
         ret = get_phys_addr_lpae(env, addr, 0, ARMMMUIdx_S2NS, &s2pa,
-                                 &txattrs, &s2prot, &s2size, fi, NULL);
+                                 &txattrs, &s2prot, &s2size, fi, pcacheattrs);
         if (ret) {
             assert(fi->type != ARMFault_None);
             fi->s2addr = addr;
@@ -XXX,XX +XXX,XX @@ static hwaddr S1_ptw_translate(CPUARMState *env, ARMMMUIdx mmu_idx,
             fi->s1ptw = true;
             return ~0;
         }
+        if (pcacheattrs && (pcacheattrs->attrs & 0xf0) == 0) {
+            /* Access was to Device memory: generate Permission fault */
+            fi->type = ARMFault_Permission;
+            fi->s2addr = addr;
+            fi->stage2 = true;
+            fi->s1ptw = true;
+            return ~0;
+        }
         addr = s2pa;
     }
     return addr;
-- 
2.19.1

Create and use a utility function to extract the EC field
from a syndrome, rather than open-coding the shift.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-9-peter.maydell@linaro.org
---
 target/arm/internals.h | 5 +++++
 target/arm/helper.c    | 4 ++--
 target/arm/kvm64.c     | 2 +-
 target/arm/op_helper.c | 2 +-
 4 files changed, 9 insertions(+), 4 deletions(-)

diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ enum arm_exception_class {
 #define ARM_EL_IL (1 << ARM_EL_IL_SHIFT)
 #define ARM_EL_ISV (1 << ARM_EL_ISV_SHIFT)
 
+static inline uint32_t syn_get_ec(uint32_t syn)
+{
+    return syn >> ARM_EL_EC_SHIFT;
+}
+
 /* Utility functions for constructing various kinds of syndrome value.
  * Note that in general we follow the AArch64 syndrome values; in a
  * few cases the value in HSR for exceptions taken to AArch32 Hyp
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_do_interrupt_aarch32(CPUState *cs)
     uint32_t moe;
 
     /* If this is a debug exception we must update the DBGDSCR.MOE bits */
-    switch (env->exception.syndrome >> ARM_EL_EC_SHIFT) {
+    switch (syn_get_ec(env->exception.syndrome)) {
     case EC_BREAKPOINT:
     case EC_BREAKPOINT_SAME_EL:
         moe = 1;
@@ -XXX,XX +XXX,XX @@ void arm_cpu_do_interrupt(CPUState *cs)
     if (qemu_loglevel_mask(CPU_LOG_INT)
         && !excp_is_internal(cs->exception_index)) {
         qemu_log_mask(CPU_LOG_INT, "...with ESR 0x%x/0x%" PRIx32 "\n",
-                      env->exception.syndrome >> ARM_EL_EC_SHIFT,
+                      syn_get_ec(env->exception.syndrome),
                       env->exception.syndrome);
     }
 
diff --git a/target/arm/kvm64.c b/target/arm/kvm64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/kvm64.c
+++ b/target/arm/kvm64.c
@@ -XXX,XX +XXX,XX @@ int kvm_arch_remove_sw_breakpoint(CPUState *cs, struct kvm_sw_breakpoint *bp)
 
 bool kvm_arm_handle_debug(CPUState *cs, struct kvm_debug_exit_arch *debug_exit)
 {
-    int hsr_ec = debug_exit->hsr >> ARM_EL_EC_SHIFT;
+    int hsr_ec = syn_get_ec(debug_exit->hsr);
     ARMCPU *cpu = ARM_CPU(cs);
     CPUClass *cc = CPU_GET_CLASS(cs);
     CPUARMState *env = &cpu->env;
diff --git a/target/arm/op_helper.c b/target/arm/op_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/op_helper.c
+++ b/target/arm/op_helper.c
@@ -XXX,XX +XXX,XX @@ void raise_exception(CPUARMState *env, uint32_t excp,
          * (see DDI0478C.a D1.10.4)
          */
         target_el = 2;
-        if (syndrome >> ARM_EL_EC_SHIFT == EC_ADVSIMDFPACCESSTRAP) {
+        if (syn_get_ec(syndrome) == EC_ADVSIMDFPACCESSTRAP) {
             syndrome = syn_uncategorized();
         }
     }
-- 
2.19.1

For the v7 version of the Arm architecture, the IL bit in
syndrome register values where the field is not valid was
defined to be UNK/SBZP. In v8 this is RES1, which is what
QEMU currently implements. Handle the desired v7 behaviour
by squashing the IL bit for the affected cases:
 * EC == EC_UNCATEGORIZED
 * prefetch aborts
 * data aborts where ISV is 0

(The fourth case listed in the v8 Arm ARM DDI 0487C.a in
section G7.2.70, "illegal state exception", can't happen
on a v7 CPU.)

This deals with a corner case noted in a comment.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-10-peter.maydell@linaro.org
---
 target/arm/internals.h |  7 ++-----
 target/arm/helper.c    | 13 +++++++++++++
 2 files changed, 15 insertions(+), 5 deletions(-)

diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ static inline uint32_t syn_get_ec(uint32_t syn)
 /* Utility functions for constructing various kinds of syndrome value.
  * Note that in general we follow the AArch64 syndrome values; in a
  * few cases the value in HSR for exceptions taken to AArch32 Hyp
- * mode differs slightly, so if we ever implemented Hyp mode then the
- * syndrome value would need some massaging on exception entry.
- * (One example of this is that AArch64 defaults to IL bit set for
- * exceptions which don't specifically indicate information about the
- * trapping instruction, whereas AArch32 defaults to IL bit clear.)
+ * mode differs slightly, and we fix this up when populating HSR in
+ * arm_cpu_do_interrupt_aarch32_hyp().
  */
 static inline uint32_t syn_uncategorized(void)
 {
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_do_interrupt_aarch32_hyp(CPUState *cs)
     }
 
     if (cs->exception_index != EXCP_IRQ && cs->exception_index != EXCP_FIQ) {
+        if (!arm_feature(env, ARM_FEATURE_V8)) {
+            /*
+             * QEMU syndrome values are v8-style. v7 has the IL bit
+             * UNK/SBZP for "field not valid" cases, where v8 uses RES1.
+             * If this is a v7 CPU, squash the IL bit in those cases.
+             */
+            if (cs->exception_index == EXCP_PREFETCH_ABORT ||
+                (cs->exception_index == EXCP_DATA_ABORT &&
+                 !(env->exception.syndrome & ARM_EL_ISV)) ||
+                syn_get_ec(env->exception.syndrome) == EC_UNCATEGORIZED) {
+                env->exception.syndrome &= ~ARM_EL_IL;
+            }
+        }
         env->cp15.esr_el[2] = env->exception.syndrome;
     }
 
-- 
2.19.1

For traps of FP/SIMD instructions to AArch32 Hyp mode, the syndrome
provided in HSR has more information than is reported to AArch64.
Specifically, there are extra fields TA and coproc which indicate
whether the trapped instruction was FP or SIMD. Add this extra
information to the syndromes we construct, and mask it out when
taking the exception to AArch64.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181012144235.19646-11-peter.maydell@linaro.org
---
 target/arm/internals.h | 14 +++++++++++++-
 target/arm/helper.c    |  9 +++++++++
 target/arm/translate.c |  8 ++++----
 3 files changed, 26 insertions(+), 5 deletions(-)

diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ static inline uint32_t syn_get_ec(uint32_t syn)
  * few cases the value in HSR for exceptions taken to AArch32 Hyp
  * mode differs slightly, and we fix this up when populating HSR in
  * arm_cpu_do_interrupt_aarch32_hyp().
+ * The exception is FP/SIMD access traps -- these report extra information
+ * when taking an exception to AArch32. For those we include the extra coproc
+ * and TA fields, and mask them out when taking the exception to AArch64.
  */
 static inline uint32_t syn_uncategorized(void)
 {
@@ -XXX,XX +XXX,XX @@ static inline uint32_t syn_cp15_rrt_trap(int cv, int cond, int opc1, int crm,
 
 static inline uint32_t syn_fp_access_trap(int cv, int cond, bool is_16bit)
 {
+    /* AArch32 FP trap or any AArch64 FP/SIMD trap: TA == 0 coproc == 0xa */
     return (EC_ADVSIMDFPACCESSTRAP << ARM_EL_EC_SHIFT)
         | (is_16bit ? 0 : ARM_EL_IL)
-        | (cv << 24) | (cond << 20);
+        | (cv << 24) | (cond << 20) | 0xa;
+}
+
+static inline uint32_t syn_simd_access_trap(int cv, int cond, bool is_16bit)
+{
+    /* AArch32 SIMD trap: TA == 1 coproc == 0 */
+    return (EC_ADVSIMDFPACCESSTRAP << ARM_EL_EC_SHIFT)
+        | (is_16bit ? 0 : ARM_EL_IL)
+        | (cv << 24) | (cond << 20) | (1 << 5);
 }
 
 static inline uint32_t syn_sve_access_trap(void)
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_do_interrupt_aarch64(CPUState *cs)
     case EXCP_HVC:
     case EXCP_HYP_TRAP:
     case EXCP_SMC:
+        if (syn_get_ec(env->exception.syndrome) == EC_ADVSIMDFPACCESSTRAP) {
+            /*
+             * QEMU internal FP/SIMD syndromes from AArch32 include the
+             * TA and coproc fields which are only exposed if the exception
+             * is taken to AArch32 Hyp mode. Mask them out to get a valid
+             * AArch64 format syndrome.
+             */
+            env->exception.syndrome &= ~MAKE_64BIT_MASK(0, 20);
+        }
         env->cp15.esr_el[new_el] = env->exception.syndrome;
         break;
     case EXCP_IRQ:
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
      */
     if (s->fp_excp_el) {
         gen_exception_insn(s, 4, EXCP_UDEF,
-                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
+                           syn_simd_access_trap(1, 0xe, false), s->fp_excp_el);
         return 0;
     }
 
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
      */
     if (s->fp_excp_el) {
         gen_exception_insn(s, 4, EXCP_UDEF,
-                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
+                           syn_simd_access_trap(1, 0xe, false), s->fp_excp_el);
         return 0;
     }
 
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
 
     if (s->fp_excp_el) {
         gen_exception_insn(s, 4, EXCP_UDEF,
-                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
+                           syn_simd_access_trap(1, 0xe, false), s->fp_excp_el);
         return 0;
     }
     if (!s->vfp_enabled) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
 
     if (s->fp_excp_el) {
         gen_exception_insn(s, 4, EXCP_UDEF,
-                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
+                           syn_simd_access_trap(1, 0xe, false), s->fp_excp_el);
         return 0;
     }
     if (!s->vfp_enabled) {
-- 
2.19.1

From: Stewart Hildebrand <Stewart.Hildebrand@dornerworks.com>

"The Image must be placed text_offset bytes from a 2MB aligned base
address anywhere in usable system RAM and called there."

For the virt board, we write our startup bootloader at the very
bottom of RAM, so that bit can't be used for the image. To avoid
overlap in case the image requests to be loaded at an offset
smaller than our bootloader, we increment the load offset to the
next 2MB.

This fixes a boot failure for Xen AArch64.

Signed-off-by: Stewart Hildebrand <stewart.hildebrand@dornerworks.com>
Tested-by: Andre Przywara <andre.przywara@arm.com>
Message-id: b8a89518794b4436af0c151ed10de4fa@dornerworks.com
[PMM: Rephrased a comment a bit]
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/arm/boot.c | 18 ++++++++++++++++++
 1 file changed, 18 insertions(+)

diff --git a/hw/arm/boot.c b/hw/arm/boot.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/boot.c
+++ b/hw/arm/boot.c
@@ -XXX,XX +XXX,XX @@
 #include "qemu/config-file.h"
 #include "qemu/option.h"
 #include "exec/address-spaces.h"
+#include "qemu/units.h"
 
 /* Kernel boot protocol is specified in the kernel docs
  * Documentation/arm/Booting and Documentation/arm64/booting.txt
@@ -XXX,XX +XXX,XX @@
 #define ARM64_TEXT_OFFSET_OFFSET    8
 #define ARM64_MAGIC_OFFSET          56
 
+#define BOOTLOADER_MAX_SIZE         (4 * KiB)
+
 AddressSpace *arm_boot_address_space(ARMCPU *cpu,
                                      const struct arm_boot_info *info)
 {
@@ -XXX,XX +XXX,XX @@ static void write_bootloader(const char *name, hwaddr addr,
         code[i] = tswap32(insn);
     }
 
+    assert((len * sizeof(uint32_t)) < BOOTLOADER_MAX_SIZE);
+
     rom_add_blob_fixed_as(name, code, len * sizeof(uint32_t), addr, as);
 
     g_free(code);
@@ -XXX,XX +XXX,XX @@ static uint64_t load_aarch64_image(const char *filename, hwaddr mem_base,
         memcpy(&hdrvals, buffer + ARM64_TEXT_OFFSET_OFFSET, sizeof(hdrvals));
         if (hdrvals[1] != 0) {
             kernel_load_offset = le64_to_cpu(hdrvals[0]);
+
+            /*
+             * We write our startup "bootloader" at the very bottom of RAM,
+             * so that bit can't be used for the image. Luckily the Image
+             * format specification is that the image requests only an offset
+             * from a 2MB boundary, not an absolute load address. So if the
+             * image requests an offset that might mean it overlaps with the
+             * bootloader, we can just load it starting at 2MB+offset rather
+             * than 0MB + offset.
+             */
+            if (kernel_load_offset < BOOTLOADER_MAX_SIZE) {
+                kernel_load_offset += 2 * MiB;
+            }
         }
     }
 
-- 
2.19.1

From: Richard Henderson <rth@twiddle.net>

This can reduce the number of opcodes required for certain
complex forms of load-multiple (e.g. ld4.16b).

Signed-off-by: Richard Henderson <rth@twiddle.net>
Message-id: 20181011205206.3552-2-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 12 ++++++++----
 1 file changed, 8 insertions(+), 4 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
     bool is_store = !extract32(insn, 22, 1);
     bool is_postidx = extract32(insn, 23, 1);
     bool is_q = extract32(insn, 30, 1);
-    TCGv_i64 tcg_addr, tcg_rn;
+    TCGv_i64 tcg_addr, tcg_rn, tcg_ebytes;
 
     int ebytes = 1 << size;
     int elements = (is_q ? 128 : 64) / (8 << size);
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
     tcg_rn = cpu_reg_sp(s, rn);
     tcg_addr = tcg_temp_new_i64();
     tcg_gen_mov_i64(tcg_addr, tcg_rn);
+    tcg_ebytes = tcg_const_i64(ebytes);
 
     for (r = 0; r < rpt; r++) {
         int e;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
                         clear_vec_high(s, is_q, tt);
                     }
                 }
-                tcg_gen_addi_i64(tcg_addr, tcg_addr, ebytes);
+                tcg_gen_add_i64(tcg_addr, tcg_addr, tcg_ebytes);
                 tt = (tt + 1) % 32;
             }
         }
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
             tcg_gen_add_i64(tcg_rn, tcg_rn, cpu_reg(s, rm));
         }
     }
+    tcg_temp_free_i64(tcg_ebytes);
     tcg_temp_free_i64(tcg_addr);
 }
 
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
     bool replicate = false;
     int index = is_q << 3 | S << 2 | size;
     int ebytes, xs;
-    TCGv_i64 tcg_addr, tcg_rn;
+    TCGv_i64 tcg_addr, tcg_rn, tcg_ebytes;
 
     switch (scale) {
     case 3:
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
     tcg_rn = cpu_reg_sp(s, rn);
     tcg_addr = tcg_temp_new_i64();
     tcg_gen_mov_i64(tcg_addr, tcg_rn);
+    tcg_ebytes = tcg_const_i64(ebytes);
 
     for (xs = 0; xs < selem; xs++) {
         if (replicate) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
                 do_vec_st(s, rt, index, tcg_addr, scale);
             }
         }
-        tcg_gen_addi_i64(tcg_addr, tcg_addr, ebytes);
+        tcg_gen_add_i64(tcg_addr, tcg_addr, tcg_ebytes);
         rt = (rt + 1) % 32;
     }
 
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
             tcg_gen_add_i64(tcg_rn, tcg_rn, cpu_reg(s, rm));
         }
     }
+    tcg_temp_free_i64(tcg_ebytes);
     tcg_temp_free_i64(tcg_addr);
 }
 
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

This is done generically in translator_loop.

Reported-by: Laurent Desnogues <laurent.desnogues@gmail.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Message-id: 20181011205206.3552-3-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 1 -
 target/arm/translate.c     | 1 -
 2 files changed, 2 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_init_disas_context(DisasContextBase *dcbase,
 
 static void aarch64_tr_tb_start(DisasContextBase *db, CPUState *cpu)
 {
-    tcg_clear_temp_count();
 }
 
 static void aarch64_tr_insn_start(DisasContextBase *dcbase, CPUState *cpu)
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void arm_tr_tb_start(DisasContextBase *dcbase, CPUState *cpu)
         tcg_gen_movi_i32(tmp, 0);
         store_cpu_field(tmp, condexec_bits);
     }
-    tcg_clear_temp_count();
 }
 
 static void arm_tr_insn_start(DisasContextBase *dcbase, CPUState *cpu)
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-4-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 28 +++-------------------------
 1 file changed, 3 insertions(+), 25 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
     for (xs = 0; xs < selem; xs++) {
         if (replicate) {
             /* Load and replicate to all elements */
-            uint64_t mulconst;
             TCGv_i64 tcg_tmp = tcg_temp_new_i64();
 
             tcg_gen_qemu_ld_i64(tcg_tmp, tcg_addr,
                                 get_mem_index(s), s->be_data + scale);
-            switch (scale) {
-            case 0:
-                mulconst = 0x0101010101010101ULL;
-                break;
-            case 1:
-                mulconst = 0x0001000100010001ULL;
-                break;
-            case 2:
-                mulconst = 0x0000000100000001ULL;
-                break;
-            case 3:
-                mulconst = 0;
-                break;
-            default:
-                g_assert_not_reached();
-            }
-            if (mulconst) {
-                tcg_gen_muli_i64(tcg_tmp, tcg_tmp, mulconst);
-            }
-            write_vec_element(s, tcg_tmp, rt, 0, MO_64);
-            if (is_q) {
-                write_vec_element(s, tcg_tmp, rt, 1, MO_64);
-            }
+            tcg_gen_gvec_dup_i64(scale, vec_full_reg_offset(s, rt),
+                                 (is_q + 1) * 8, vec_full_reg_size(s),
+                                 tcg_tmp);
             tcg_temp_free_i64(tcg_tmp);
-            clear_vec_high(s, is_q, rt);
         } else {
             /* Load/store one element per register */
             if (is_load) {
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

For a sequence of loads or stores from a single register,
little-endian operations can be promoted to an 8-byte op.
This can reduce the number of operations by a factor of 8.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-5-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 66 +++++++++++++++++++++++---------------
 1 file changed, 40 insertions(+), 26 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void write_vec_element_i32(DisasContext *s, TCGv_i32 tcg_src,
 
 /* Store from vector register to memory */
 static void do_vec_st(DisasContext *s, int srcidx, int element,
-                      TCGv_i64 tcg_addr, int size)
+                      TCGv_i64 tcg_addr, int size, TCGMemOp endian)
 {
-    TCGMemOp memop = s->be_data + size;
     TCGv_i64 tcg_tmp = tcg_temp_new_i64();
 
     read_vec_element(s, tcg_tmp, srcidx, element, size);
-    tcg_gen_qemu_st_i64(tcg_tmp, tcg_addr, get_mem_index(s), memop);
+    tcg_gen_qemu_st_i64(tcg_tmp, tcg_addr, get_mem_index(s), endian | size);
 
     tcg_temp_free_i64(tcg_tmp);
 }
 
 /* Load from memory to vector register */
 static void do_vec_ld(DisasContext *s, int destidx, int element,
-                      TCGv_i64 tcg_addr, int size)
+                      TCGv_i64 tcg_addr, int size, TCGMemOp endian)
 {
-    TCGMemOp memop = s->be_data + size;
     TCGv_i64 tcg_tmp = tcg_temp_new_i64();
 
-    tcg_gen_qemu_ld_i64(tcg_tmp, tcg_addr, get_mem_index(s), memop);
+    tcg_gen_qemu_ld_i64(tcg_tmp, tcg_addr, get_mem_index(s), endian | size);
     write_vec_element(s, tcg_tmp, destidx, element, size);
 
     tcg_temp_free_i64(tcg_tmp);
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
     bool is_postidx = extract32(insn, 23, 1);
     bool is_q = extract32(insn, 30, 1);
     TCGv_i64 tcg_addr, tcg_rn, tcg_ebytes;
+    TCGMemOp endian = s->be_data;
 
-    int ebytes = 1 << size;
-    int elements = (is_q ? 128 : 64) / (8 << size);
+    int ebytes;   /* bytes per element */
+    int elements; /* elements per vector */
     int rpt;    /* num iterations */
     int selem;  /* structure elements */
     int r;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
         gen_check_sp_alignment(s);
     }
 
+    /* For our purposes, bytes are always little-endian.  */
+    if (size == 0) {
+        endian = MO_LE;
+    }
+
+    /* Consecutive little-endian elements from a single register
+     * can be promoted to a larger little-endian operation.
+     */
+    if (selem == 1 && endian == MO_LE) {
+        size = 3;
+    }
+    ebytes = 1 << size;
+    elements = (is_q ? 16 : 8) / ebytes;
+
     tcg_rn = cpu_reg_sp(s, rn);
     tcg_addr = tcg_temp_new_i64();
     tcg_gen_mov_i64(tcg_addr, tcg_rn);
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
     for (r = 0; r < rpt; r++) {
         int e;
         for (e = 0; e < elements; e++) {
-            int tt = (rt + r) % 32;
             int xs;
             for (xs = 0; xs < selem; xs++) {
+                int tt = (rt + r + xs) % 32;
                 if (is_store) {
-                    do_vec_st(s, tt, e, tcg_addr, size);
+                    do_vec_st(s, tt, e, tcg_addr, size, endian);
                 } else {
-                    do_vec_ld(s, tt, e, tcg_addr, size);
-
-                    /* For non-quad operations, setting a slice of the low
-                     * 64 bits of the register clears the high 64 bits (in
-                     * the ARM ARM pseudocode this is implicit in the fact
-                     * that 'rval' is a 64 bit wide variable).
-                     * For quad operations, we might still need to zero the
-                     * high bits of SVE.  We optimize by noticing that we only
-                     * need to do this the first time we touch a register.
-                     */
-                    if (e == 0 && (r == 0 || xs == selem - 1)) {
-                        clear_vec_high(s, is_q, tt);
-                    }
+                    do_vec_ld(s, tt, e, tcg_addr, size, endian);
                 }
                 tcg_gen_add_i64(tcg_addr, tcg_addr, tcg_ebytes);
-                tt = (tt + 1) % 32;
             }
         }
     }
 
+    if (!is_store) {
+        /* For non-quad operations, setting a slice of the low
+         * 64 bits of the register clears the high 64 bits (in
+         * the ARM ARM pseudocode this is implicit in the fact
+         * that 'rval' is a 64 bit wide variable).
+         * For quad operations, we might still need to zero the
+         * high bits of SVE.
+         */
+        for (r = 0; r < rpt * selem; r++) {
+            int tt = (rt + r) % 32;
+            clear_vec_high(s, is_q, tt);
+        }
+    }
+
     if (is_postidx) {
         int rm = extract32(insn, 16, 5);
         if (rm == 31) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
         } else {
             /* Load/store one element per register */
             if (is_load) {
-                do_vec_ld(s, rt, index, tcg_addr, scale);
+                do_vec_ld(s, rt, index, tcg_addr, scale, s->be_data);
             } else {
-                do_vec_st(s, rt, index, tcg_addr, scale);
+                do_vec_st(s, rt, index, tcg_addr, scale, s->be_data);
             }
         }
         tcg_gen_add_i64(tcg_addr, tcg_addr, tcg_ebytes);
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Message-id: 20181011205206.3552-6-richard.henderson@linaro.org
[PMM: drop change to now-deleted cpu_mode_names array]
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 4 ++--
 1 file changed, 2 insertions(+), 2 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static TCGv_i64 cpu_F0d, cpu_F1d;
 
 #include "exec/gen-icount.h"
 
-static const char *regnames[] =
+static const char * const regnames[] =
     { "r0", "r1", "r2", "r3", "r4", "r5", "r6", "r7",
       "r8", "r9", "r10", "r11", "r12", "r13", "r14", "pc" };
 
@@ -XXX,XX +XXX,XX @@ static struct {
     int nregs;
     int interleave;
     int spacing;
-} neon_ls_element_type[11] = {
+} const neon_ls_element_type[11] = {
     {4, 4, 1},
     {4, 4, 2},
     {4, 1, 1},
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Also introduces neon_element_offset to find the env offset
of a specific element within a neon register.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-7-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 63 ++++++++++++++++++++++++------------------
 1 file changed, 36 insertions(+), 27 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ neon_reg_offset (int reg, int n)
     return vfp_reg_offset(0, sreg);
 }
 
+/* Return the offset of a 2**SIZE piece of a NEON register, at index ELE,
+ * where 0 is the least significant end of the register.
+ */
+static inline long
+neon_element_offset(int reg, int element, TCGMemOp size)
+{
+    int element_size = 1 << size;
+    int ofs = element * element_size;
+#ifdef HOST_WORDS_BIGENDIAN
+    /* Calculate the offset assuming fully little-endian,
+     * then XOR to account for the order of the 8-byte units.
+     */
+    if (element_size < 8) {
+        ofs ^= 8 - element_size;
+    }
+#endif
+    return neon_reg_offset(reg, 0) + ofs;
+}
+
 static TCGv_i32 neon_load_reg(int reg, int pass)
 {
     TCGv_i32 tmp = tcg_temp_new_i32();
@@ -XXX,XX +XXX,XX @@ static int disas_vfp_insn(DisasContext *s, uint32_t insn)
                     tmp = load_reg(s, rd);
                     if (insn & (1 << 23)) {
                         /* VDUP */
-                        if (size == 0) {
-                            gen_neon_dup_u8(tmp, 0);
-                        } else if (size == 1) {
-                            gen_neon_dup_low16(tmp);
-                        }
-                        for (n = 0; n <= pass * 2; n++) {
-                            tmp2 = tcg_temp_new_i32();
-                            tcg_gen_mov_i32(tmp2, tmp);
-                            neon_store_reg(rn, n, tmp2);
-                        }
-                        neon_store_reg(rn, n, tmp);
+                        int vec_size = pass ? 16 : 8;
+                        tcg_gen_gvec_dup_i32(size, neon_reg_offset(rn, 0),
+                                             vec_size, vec_size, tmp);
+                        tcg_temp_free_i32(tmp);
                     } else {
                         /* VMOV */
                         switch (size) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 tcg_temp_free_i32(tmp);
             } else if ((insn & 0x380) == 0) {
                 /* VDUP */
+                int element;
+                TCGMemOp size;
+
                 if ((insn & (7 << 16)) == 0 || (q && (rd & 1))) {
                     return 1;
                 }
-                if (insn & (1 << 19)) {
-                    tmp = neon_load_reg(rm, 1);
-                } else {
-                    tmp = neon_load_reg(rm, 0);
-                }
                 if (insn & (1 << 16)) {
-                    gen_neon_dup_u8(tmp, ((insn >> 17) & 3) * 8);
+                    size = MO_8;
+                    element = (insn >> 17) & 7;
                 } else if (insn & (1 << 17)) {
-                    if ((insn >> 18) & 1)
-                        gen_neon_dup_high16(tmp);
-                    else
-                        gen_neon_dup_low16(tmp);
+                    size = MO_16;
+                    element = (insn >> 18) & 3;
+                } else {
+                    size = MO_32;
+                    element = (insn >> 19) & 1;
                 }
-                for (pass = 0; pass < (q ? 4 : 2); pass++) {
-                    tmp2 = tcg_temp_new_i32();
-                    tcg_gen_mov_i32(tmp2, tmp);
-                    neon_store_reg(rd, pass, tmp2);
-                }
-                tcg_temp_free_i32(tmp);
+                tcg_gen_gvec_dup_mem(size, neon_reg_offset(rd, 0),
+                                     neon_element_offset(rm, element, size),
+                                     q ? 16 : 8, q ? 16 : 8);
             } else {
                 return 1;
             }
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-8-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 67 ++++++++++++++++++++++++------------------
 1 file changed, 39 insertions(+), 28 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 return 1;
             }
         } else { /* (insn & 0x00380080) == 0 */
-            int invert;
+            int invert, reg_ofs, vec_size;
+
             if (q && (rd & 1)) {
                 return 1;
             }
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 break;
             case 14:
                 imm |= (imm << 8) | (imm << 16) | (imm << 24);
-                if (invert)
+                if (invert) {
                     imm = ~imm;
+                }
                 break;
             case 15:
                 if (invert) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                       | ((imm & 0x40) ? (0x1f << 25) : (1 << 30));
                 break;
             }
-            if (invert)
+            if (invert) {
                 imm = ~imm;
+            }
 
-            for (pass = 0; pass < (q ? 4 : 2); pass++) {
-                if (op & 1 && op < 12) {
-                    tmp = neon_load_reg(rd, pass);
-                    if (invert) {
-                        /* The immediate value has already been inverted, so
-                           BIC becomes AND.  */
-                        tcg_gen_andi_i32(tmp, tmp, imm);
-                    } else {
-                        tcg_gen_ori_i32(tmp, tmp, imm);
-                    }
+            reg_ofs = neon_reg_offset(rd, 0);
+            vec_size = q ? 16 : 8;
+
+            if (op & 1 && op < 12) {
+                if (invert) {
+                    /* The immediate value has already been inverted,
+                     * so BIC becomes AND.
+                     */
+                    tcg_gen_gvec_andi(MO_32, reg_ofs, reg_ofs, imm,
+                                      vec_size, vec_size);
                 } else {
-                    /* VMOV, VMVN.  */
-                    tmp = tcg_temp_new_i32();
-                    if (op == 14 && invert) {
-                        int n;
-                        uint32_t val;
-                        val = 0;
-                        for (n = 0; n < 4; n++) {
-                            if (imm & (1 << (n + (pass & 1) * 4)))
-                                val |= 0xff << (n * 8);
-                        }
-                        tcg_gen_movi_i32(tmp, val);
-                    } else {
-                        tcg_gen_movi_i32(tmp, imm);
-                    }
+                    tcg_gen_gvec_ori(MO_32, reg_ofs, reg_ofs, imm,
+                                     vec_size, vec_size);
+                }
+            } else {
+                /* VMOV, VMVN.  */
+                if (op == 14 && invert) {
+                    TCGv_i64 t64 = tcg_temp_new_i64();
+
+                    for (pass = 0; pass <= q; ++pass) {
+                        uint64_t val = 0;
+                        int n;
+
+                        for (n = 0; n < 8; n++) {
+                            if (imm & (1 << (n + pass * 8))) {
+                                val |= 0xffull << (n * 8);
+                            }
+                        }
+                        tcg_gen_movi_i64(t64, val);
+                        neon_store_reg64(t64, rd + pass);
+                    }
+                    tcg_temp_free_i64(t64);
+                } else {
+                    tcg_gen_gvec_dup32i(reg_ofs, vec_size, vec_size, imm);
                 }
-                neon_store_reg(rd, pass, tmp);
             }
         }
     } else { /* (insn & 0x00800010 == 0x00800000) */
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Move expanders for VBSL, VBIT, and VBIF from translate-a64.c.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-9-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.h     |   6 ++
 target/arm/translate-a64.c |  61 --------------
 target/arm/translate.c     | 162 +++++++++++++++++++++++++++----------
 3 files changed, 124 insertions(+), 105 deletions(-)

diff --git a/target/arm/translate.h b/target/arm/translate.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.h
+++ b/target/arm/translate.h
@@ -XXX,XX +XXX,XX @@ static inline TCGv_i32 get_ahp_flag(void)
     return ret;
 }
 
+
+/* Vector operations shared between ARM and AArch64.  */
+extern const GVecGen3 bsl_op;
+extern const GVecGen3 bit_op;
+extern const GVecGen3 bif_op;
+
 /*
  * Forward to the isar_feature_* tests given a DisasContext pointer.
  */
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_diff(DisasContext *s, uint32_t insn)
     }
 }
 
-static void gen_bsl_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
-{
-    tcg_gen_xor_i64(rn, rn, rm);
-    tcg_gen_and_i64(rn, rn, rd);
-    tcg_gen_xor_i64(rd, rm, rn);
-}
-
-static void gen_bit_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
-{
-    tcg_gen_xor_i64(rn, rn, rd);
-    tcg_gen_and_i64(rn, rn, rm);
-    tcg_gen_xor_i64(rd, rd, rn);
-}
-
-static void gen_bif_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
-{
-    tcg_gen_xor_i64(rn, rn, rd);
-    tcg_gen_andc_i64(rn, rn, rm);
-    tcg_gen_xor_i64(rd, rd, rn);
-}
-
-static void gen_bsl_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
-{
-    tcg_gen_xor_vec(vece, rn, rn, rm);
-    tcg_gen_and_vec(vece, rn, rn, rd);
-    tcg_gen_xor_vec(vece, rd, rm, rn);
-}
-
-static void gen_bit_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
-{
-    tcg_gen_xor_vec(vece, rn, rn, rd);
-    tcg_gen_and_vec(vece, rn, rn, rm);
-    tcg_gen_xor_vec(vece, rd, rd, rn);
-}
-
-static void gen_bif_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
-{
-    tcg_gen_xor_vec(vece, rn, rn, rd);
-    tcg_gen_andc_vec(vece, rn, rn, rm);
-    tcg_gen_xor_vec(vece, rd, rd, rn);
-}
-
 /* Logic op (opcode == 3) subgroup of C3.6.16. */
 static void disas_simd_3same_logic(DisasContext *s, uint32_t insn)
 {
-    static const GVecGen3 bsl_op = {
-        .fni8 = gen_bsl_i64,
-        .fniv = gen_bsl_vec,
-        .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-        .load_dest = true
-    };
-    static const GVecGen3 bit_op = {
-        .fni8 = gen_bit_i64,
-        .fniv = gen_bit_vec,
-        .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-        .load_dest = true
-    };
-    static const GVecGen3 bif_op = {
-        .fni8 = gen_bif_i64,
-        .fniv = gen_bif_vec,
-        .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-        .load_dest = true
-    };
-
     int rd = extract32(insn, 0, 5);
     int rn = extract32(insn, 5, 5);
     int rm = extract32(insn, 16, 5);
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
     return 0;
 }
 
-/* Bitwise select.  dest = c ? t : f.  Clobbers T and F.  */
-static void gen_neon_bsl(TCGv_i32 dest, TCGv_i32 t, TCGv_i32 f, TCGv_i32 c)
-{
-    tcg_gen_and_i32(t, t, c);
-    tcg_gen_andc_i32(f, f, c);
-    tcg_gen_or_i32(dest, t, f);
-}
-
 static inline void gen_neon_narrow(int size, TCGv_i32 dest, TCGv_i64 src)
 {
     switch (size) {
@@ -XXX,XX +XXX,XX @@ static int do_v81_helper(DisasContext *s, gen_helper_gvec_3_ptr *fn,
     return 1;
 }
 
+/*
+ * Expanders for VBitOps_VBIF, VBIT, VBSL.
+ */
+static void gen_bsl_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
+{
+    tcg_gen_xor_i64(rn, rn, rm);
+    tcg_gen_and_i64(rn, rn, rd);
+    tcg_gen_xor_i64(rd, rm, rn);
+}
+
+static void gen_bit_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
+{
+    tcg_gen_xor_i64(rn, rn, rd);
+    tcg_gen_and_i64(rn, rn, rm);
+    tcg_gen_xor_i64(rd, rd, rn);
+}
+
+static void gen_bif_i64(TCGv_i64 rd, TCGv_i64 rn, TCGv_i64 rm)
+{
+    tcg_gen_xor_i64(rn, rn, rd);
+    tcg_gen_andc_i64(rn, rn, rm);
+    tcg_gen_xor_i64(rd, rd, rn);
+}
+
+static void gen_bsl_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
+{
+    tcg_gen_xor_vec(vece, rn, rn, rm);
+    tcg_gen_and_vec(vece, rn, rn, rd);
+    tcg_gen_xor_vec(vece, rd, rm, rn);
+}
+
+static void gen_bit_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
+{
+    tcg_gen_xor_vec(vece, rn, rn, rd);
+    tcg_gen_and_vec(vece, rn, rn, rm);
+    tcg_gen_xor_vec(vece, rd, rd, rn);
+}
+
+static void gen_bif_vec(unsigned vece, TCGv_vec rd, TCGv_vec rn, TCGv_vec rm)
+{
+    tcg_gen_xor_vec(vece, rn, rn, rd);
+    tcg_gen_andc_vec(vece, rn, rn, rm);
+    tcg_gen_xor_vec(vece, rd, rd, rn);
+}
+
+const GVecGen3 bsl_op = {
+    .fni8 = gen_bsl_i64,
+    .fniv = gen_bsl_vec,
+    .prefer_i64 = TCG_TARGET_REG_BITS == 64,
+    .load_dest = true
+};
+
+const GVecGen3 bit_op = {
+    .fni8 = gen_bit_i64,
+    .fniv = gen_bit_vec,
+    .prefer_i64 = TCG_TARGET_REG_BITS == 64,
+    .load_dest = true
+};
+
+const GVecGen3 bif_op = {
+    .fni8 = gen_bif_i64,
+    .fniv = gen_bif_vec,
+    .prefer_i64 = TCG_TARGET_REG_BITS == 64,
+    .load_dest = true
+};
+
+
 /* Translate a NEON data processing instruction.  Return nonzero if the
    instruction is invalid.
    We process data in a mixture of 32-bit and 64-bit chunks.
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
 {
     int op;
     int q;
-    int rd, rn, rm;
+    int rd, rn, rm, rd_ofs, rn_ofs, rm_ofs;
     int size;
     int shift;
     int pass;
     int count;
     int pairwise;
     int u;
+    int vec_size;
     uint32_t imm, mask;
     TCGv_i32 tmp, tmp2, tmp3, tmp4, tmp5;
     TCGv_ptr ptr1, ptr2, ptr3;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
     VFP_DREG_N(rn, insn);
     VFP_DREG_M(rm, insn);
     size = (insn >> 20) & 3;
+    vec_size = q ? 16 : 8;
+    rd_ofs = neon_reg_offset(rd, 0);
+    rn_ofs = neon_reg_offset(rn, 0);
+    rm_ofs = neon_reg_offset(rm, 0);
+
     if ((insn & (1 << 23)) == 0) {
         /* Three register same length.  */
         op = ((insn >> 7) & 0x1e) | ((insn >> 4) & 1);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                                      q, rd, rn, rm);
             }
             return 1;
+
+        case NEON_3R_LOGIC: /* Logic ops.  */
+            switch ((u << 2) | size) {
+            case 0: /* VAND */
+                tcg_gen_gvec_and(0, rd_ofs, rn_ofs, rm_ofs,
+                                 vec_size, vec_size);
+                break;
+            case 1: /* VBIC */
+                tcg_gen_gvec_andc(0, rd_ofs, rn_ofs, rm_ofs,
+                                  vec_size, vec_size);
+                break;
+            case 2:
+                if (rn == rm) {
+                    /* VMOV */
+                    tcg_gen_gvec_mov(0, rd_ofs, rn_ofs, vec_size, vec_size);
+                } else {
+                    /* VORR */
+                    tcg_gen_gvec_or(0, rd_ofs, rn_ofs, rm_ofs,
+                                    vec_size, vec_size);
+                }
+                break;
+            case 3: /* VORN */
+                tcg_gen_gvec_orc(0, rd_ofs, rn_ofs, rm_ofs,
+                                 vec_size, vec_size);
+                break;
+            case 4: /* VEOR */
+                tcg_gen_gvec_xor(0, rd_ofs, rn_ofs, rm_ofs,
+                                 vec_size, vec_size);
+                break;
+            case 5: /* VBSL */
+                tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs,
+                               vec_size, vec_size, &bsl_op);
+                break;
+            case 6: /* VBIT */
+                tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs,
+                               vec_size, vec_size, &bit_op);
+                break;
+            case 7: /* VBIF */
+                tcg_gen_gvec_3(rd_ofs, rn_ofs, rm_ofs,
+                               vec_size, vec_size, &bif_op);
+                break;
+            }
+            return 0;
         }
-        if (size == 3 && op != NEON_3R_LOGIC) {
+        if (size == 3) {
             /* 64-bit element instructions. */
             for (pass = 0; pass < (q ? 2 : 1); pass++) {
                 neon_load_reg64(cpu_V0, rn + pass);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
         case NEON_3R_VRHADD:
             GEN_NEON_INTEGER_OP(rhadd);
             break;
-        case NEON_3R_LOGIC: /* Logic ops.  */
-            switch ((u << 2) | size) {
-            case 0: /* VAND */
-                tcg_gen_and_i32(tmp, tmp, tmp2);
-                break;
-            case 1: /* BIC */
-                tcg_gen_andc_i32(tmp, tmp, tmp2);
-                break;
-            case 2: /* VORR */
-                tcg_gen_or_i32(tmp, tmp, tmp2);
-                break;
-            case 3: /* VORN */
-                tcg_gen_orc_i32(tmp, tmp, tmp2);
-                break;
-            case 4: /* VEOR */
-                tcg_gen_xor_i32(tmp, tmp, tmp2);
-                break;
-            case 5: /* VBSL */
-                tmp3 = neon_load_reg(rd, pass);
-                gen_neon_bsl(tmp, tmp, tmp2, tmp3);
-                tcg_temp_free_i32(tmp3);
-                break;
-            case 6: /* VBIT */
-                tmp3 = neon_load_reg(rd, pass);
-                gen_neon_bsl(tmp, tmp, tmp3, tmp2);
-                tcg_temp_free_i32(tmp3);
-                break;
-            case 7: /* VBIF */
-                tmp3 = neon_load_reg(rd, pass);
-                gen_neon_bsl(tmp, tmp3, tmp, tmp2);
-                tcg_temp_free_i32(tmp3);
-                break;
-            }
-            break;
         case NEON_3R_VHSUB:
             GEN_NEON_INTEGER_OP(hsub);
             break;
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-10-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 29 ++++++++++-------------------
 1 file changed, 10 insertions(+), 19 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 break;
             }
             return 0;
+
+        case NEON_3R_VADD_VSUB:
+            if (u) {
+                tcg_gen_gvec_sub(size, rd_ofs, rn_ofs, rm_ofs,
+                                 vec_size, vec_size);
+            } else {
+                tcg_gen_gvec_add(size, rd_ofs, rn_ofs, rm_ofs,
+                                 vec_size, vec_size);
+            }
+            return 0;
         }
         if (size == 3) {
             /* 64-bit element instructions. */
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                                                   cpu_V1, cpu_V0);
                     }
                     break;
-                case NEON_3R_VADD_VSUB:
-                    if (u) {
-                        tcg_gen_sub_i64(CPU_V001);
-                    } else {
-                        tcg_gen_add_i64(CPU_V001);
-                    }
-                    break;
                 default:
                     abort();
                 }
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
             tmp2 = neon_load_reg(rd, pass);
             gen_neon_add(size, tmp, tmp2);
             break;
-        case NEON_3R_VADD_VSUB:
-            if (!u) { /* VADD */
-                gen_neon_add(size, tmp, tmp2);
-            } else { /* VSUB */
-                switch (size) {
-                case 0: gen_helper_neon_sub_u8(tmp, tmp, tmp2); break;
-                case 1: gen_helper_neon_sub_u16(tmp, tmp, tmp2); break;
-                case 2: tcg_gen_sub_i32(tmp, tmp, tmp2); break;
-                default: abort();
-                }
-            }
-            break;
         case NEON_3R_VTST_VCEQ:
             if (!u) { /* VTST */
                 switch (size) {
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-11-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 16 ++++++++--------
 1 file changed, 8 insertions(+), 8 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                     tcg_temp_free_ptr(ptr1);
                     tcg_temp_free_ptr(ptr2);
                     break;
+
+                case NEON_2RM_VMVN:
+                    tcg_gen_gvec_not(0, rd_ofs, rm_ofs, vec_size, vec_size);
+                    break;
+                case NEON_2RM_VNEG:
+                    tcg_gen_gvec_neg(size, rd_ofs, rm_ofs, vec_size, vec_size);
+                    break;
+
                 default:
                 elementwise:
                     for (pass = 0; pass < (q ? 4 : 2); pass++) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                         case NEON_2RM_VCNT:
                             gen_helper_neon_cnt_u8(tmp, tmp);
                             break;
-                        case NEON_2RM_VMVN:
-                            tcg_gen_not_i32(tmp, tmp);
-                            break;
                         case NEON_2RM_VQABS:
                             switch (size) {
                             case 0:
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                             default: abort();
                             }
                             break;
-                        case NEON_2RM_VNEG:
-                            tmp2 = tcg_const_i32(0);
-                            gen_neon_rsb(size, tmp, tmp2);
-                            tcg_temp_free_i32(tmp2);
-                            break;
                         case NEON_2RM_VCGT0_F:
                         {
                             TCGv_ptr fpstatus = get_fpstatus_ptr(1);
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-12-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 31 +++++++++++++++----------------
 1 file changed, 15 insertions(+), 16 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                                  vec_size, vec_size);
             }
             return 0;
+
+        case NEON_3R_VMUL: /* VMUL */
+            if (u) {
+                /* Polynomial case allows only P8 and is handled below.  */
+                if (size != 0) {
+                    return 1;
+                }
+            } else {
+                tcg_gen_gvec_mul(size, rd_ofs, rn_ofs, rm_ofs,
+                                 vec_size, vec_size);
+                return 0;
+            }
+            break;
         }
         if (size == 3) {
             /* 64-bit element instructions. */
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 return 1;
             }
             break;
-        case NEON_3R_VMUL:
-            if (u && (size != 0)) {
-                /* UNDEF on invalid size for polynomial subcase */
-                return 1;
-            }
-            break;
         case NEON_3R_VFM_VQRDMLSH:
             if (!arm_dc_feature(s, ARM_FEATURE_VFP4)) {
                 return 1;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
             }
             break;
         case NEON_3R_VMUL:
-            if (u) { /* polynomial */
-                gen_helper_neon_mul_p8(tmp, tmp, tmp2);
-            } else { /* Integer */
-                switch (size) {
-                case 0: gen_helper_neon_mul_u8(tmp, tmp, tmp2); break;
-                case 1: gen_helper_neon_mul_u16(tmp, tmp, tmp2); break;
-                case 2: tcg_gen_mul_i32(tmp, tmp, tmp2); break;
-                default: abort();
-                }
-            }
+            /* VMUL.P8; other cases already eliminated.  */
+            gen_helper_neon_mul_p8(tmp, tmp, tmp2);
             break;
         case NEON_3R_VPMAX:
             GEN_NEON_INTEGER_OP(pmax);
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-13-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 70 +++++++++++++++++++++++++++++-------------
 1 file changed, 48 insertions(+), 22 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                     size--;
             }
             shift = (insn >> 16) & ((1 << (3 + size)) - 1);
-            /* To avoid excessive duplication of ops we implement shift
-               by immediate using the variable shift operations.  */
             if (op < 8) {
                 /* Shift by immediate:
                    VSHR, VSRA, VRSHR, VRSRA, VSRI, VSHL, VQSHL, VQSHLU.  */
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                 }
                 /* Right shifts are encoded as N - shift, where N is the
                    element size in bits.  */
-                if (op <= 4)
+                if (op <= 4) {
                     shift = shift - (1 << (size + 3));
+                }
+
+                switch (op) {
+                case 0:  /* VSHR */
+                    /* Right shift comes here negative.  */
+                    shift = -shift;
+                    /* Shifts larger than the element size are architecturally
+                     * valid.  Unsigned results in all zeros; signed results
+                     * in all sign bits.
+                     */
+                    if (!u) {
+                        tcg_gen_gvec_sari(size, rd_ofs, rm_ofs,
+                                          MIN(shift, (8 << size) - 1),
+                                          vec_size, vec_size);
+                    } else if (shift >= 8 << size) {
+                        tcg_gen_gvec_dup8i(rd_ofs, vec_size, vec_size, 0);
+                    } else {
+                        tcg_gen_gvec_shri(size, rd_ofs, rm_ofs, shift,
+                                          vec_size, vec_size);
+                    }
+                    return 0;
+
+                case 5: /* VSHL, VSLI */
+                    if (!u) { /* VSHL */
+                        /* Shifts larger than the element size are
+                         * architecturally valid and results in zero.
+                         */
+                        if (shift >= 8 << size) {
+                            tcg_gen_gvec_dup8i(rd_ofs, vec_size, vec_size, 0);
+                        } else {
+                            tcg_gen_gvec_shli(size, rd_ofs, rm_ofs, shift,
+                                              vec_size, vec_size);
+                        }
+                        return 0;
+                    }
+                    break;
+                }
+
                 if (size == 3) {
                     count = q + 1;
                 } else {
                     count = q ? 4: 2;
                 }
-                switch (size) {
-                case 0:
-                    imm = (uint8_t) shift;
-                    imm |= imm << 8;
-                    imm |= imm << 16;
-                    break;
-                case 1:
-                    imm = (uint16_t) shift;
-                    imm |= imm << 16;
-                    break;
-                case 2:
-                case 3:
-                    imm = shift;
-                    break;
-                default:
-                    abort();
-                }
+
+                /* To avoid excessive duplication of ops we implement shift
+                 * by immediate using the variable shift operations.
+                  */
+                imm = dup_const(size, shift);
 
                 for (pass = 0; pass < count; pass++) {
                     if (size == 3) {
                         neon_load_reg64(cpu_V0, rm + pass);
                         tcg_gen_movi_i64(cpu_V1, imm);
                         switch (op) {
-                        case 0:  /* VSHR */
                         case 1:  /* VSRA */
                             if (u)
                                 gen_helper_neon_shl_u64(cpu_V0, cpu_V0, cpu_V1);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                                                          cpu_V0, cpu_V1);
                             }
                             break;
+                        default:
+                            g_assert_not_reached();
                         }
                         if (op == 1 || op == 3) {
                             /* Accumulate.  */
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                         tmp2 = tcg_temp_new_i32();
                         tcg_gen_movi_i32(tmp2, imm);
                         switch (op) {
-                        case 0:  /* VSHR */
                         case 1:  /* VSRA */
                             GEN_NEON_INTEGER_OP(shl);
                             break;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                         case 7: /* VQSHL */
                             GEN_NEON_INTEGER_OP_ENV(qshl);
                             break;
+                        default:
+                            g_assert_not_reached();
                         }
                         tcg_temp_free_i32(tmp2);
 
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Move ssra_op and usra_op expanders from translate-a64.c.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-14-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.h     |   2 +
 target/arm/translate-a64.c | 106 ----------------------------
 target/arm/translate.c     | 139 ++++++++++++++++++++++++++++++++++---
 3 files changed, 130 insertions(+), 117 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Move shi_op and sli_op expanders from translate-a64.c.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-15-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.h     |   2 +
 target/arm/translate-a64.c | 152 +----------------------
 target/arm/translate.c     | 244 ++++++++++++++++++++++++++-----------
 3 files changed, 179 insertions(+), 219 deletions(-)

diff --git a/target/arm/translate.h b/target/arm/translate.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.h
+++ b/target/arm/translate.h
@@ -XXX,XX +XXX,XX @@ extern const GVecGen3 bit_op;
 extern const GVecGen3 bif_op;
 extern const GVecGen2i ssra_op[4];
 extern const GVecGen2i usra_op[4];
+extern const GVecGen2i sri_op[4];
+extern const GVecGen2i sli_op[4];
 
 /*
  * Forward to the isar_feature_* tests given a DisasContext pointer.
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_simd_scalar_two_reg_misc(DisasContext *s, uint32_t insn)
     }
 }
 
-static void gen_shr8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-{
-    uint64_t mask = dup_const(MO_8, 0xff >> shift);
-    TCGv_i64 t = tcg_temp_new_i64();
-
-    tcg_gen_shri_i64(t, a, shift);
-    tcg_gen_andi_i64(t, t, mask);
-    tcg_gen_andi_i64(d, d, ~mask);
-    tcg_gen_or_i64(d, d, t);
-    tcg_temp_free_i64(t);
-}
-
-static void gen_shr16_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-{
-    uint64_t mask = dup_const(MO_16, 0xffff >> shift);
-    TCGv_i64 t = tcg_temp_new_i64();
-
-    tcg_gen_shri_i64(t, a, shift);
-    tcg_gen_andi_i64(t, t, mask);
-    tcg_gen_andi_i64(d, d, ~mask);
-    tcg_gen_or_i64(d, d, t);
-    tcg_temp_free_i64(t);
-}
-
-static void gen_shr32_ins_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
-{
-    tcg_gen_shri_i32(a, a, shift);
-    tcg_gen_deposit_i32(d, d, a, 0, 32 - shift);
-}
-
-static void gen_shr64_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-{
-    tcg_gen_shri_i64(a, a, shift);
-    tcg_gen_deposit_i64(d, d, a, 0, 64 - shift);
-}
-
-static void gen_shr_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
-{
-    uint64_t mask = (2ull << ((8 << vece) - 1)) - 1;
-    TCGv_vec t = tcg_temp_new_vec_matching(d);
-    TCGv_vec m = tcg_temp_new_vec_matching(d);
-
-    tcg_gen_dupi_vec(vece, m, mask ^ (mask >> sh));
-    tcg_gen_shri_vec(vece, t, a, sh);
-    tcg_gen_and_vec(vece, d, d, m);
-    tcg_gen_or_vec(vece, d, d, t);
-
-    tcg_temp_free_vec(t);
-    tcg_temp_free_vec(m);
-}
-
 /* SSHR[RA]/USHR[RA] - Vector shift right (optional rounding/accumulate) */
 static void handle_vec_simd_shri(DisasContext *s, bool is_q, bool is_u,
                                  int immh, int immb, int opcode, int rn, int rd)
 {
-    static const GVecGen2i sri_op[4] = {
-        { .fni8 = gen_shr8_ins_i64,
-          .fniv = gen_shr_ins_vec,
-          .load_dest = true,
-          .opc = INDEX_op_shri_vec,
-          .vece = MO_8 },
-        { .fni8 = gen_shr16_ins_i64,
-          .fniv = gen_shr_ins_vec,
-          .load_dest = true,
-          .opc = INDEX_op_shri_vec,
-          .vece = MO_16 },
-        { .fni4 = gen_shr32_ins_i32,
-          .fniv = gen_shr_ins_vec,
-          .load_dest = true,
-          .opc = INDEX_op_shri_vec,
-          .vece = MO_32 },
-        { .fni8 = gen_shr64_ins_i64,
-          .fniv = gen_shr_ins_vec,
-          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-          .load_dest = true,
-          .opc = INDEX_op_shri_vec,
-          .vece = MO_64 },
-    };
-
     int size = 32 - clz32(immh) - 1;
     int immhb = immh << 3 | immb;
     int shift = 2 * (8 << size) - immhb;
@@ -XXX,XX +XXX,XX @@ static void handle_vec_simd_shri(DisasContext *s, bool is_q, bool is_u,
     clear_vec_high(s, is_q, rd);
 }
 
-static void gen_shl8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-{
-    uint64_t mask = dup_const(MO_8, 0xff << shift);
-    TCGv_i64 t = tcg_temp_new_i64();
-
-    tcg_gen_shli_i64(t, a, shift);
-    tcg_gen_andi_i64(t, t, mask);
-    tcg_gen_andi_i64(d, d, ~mask);
-    tcg_gen_or_i64(d, d, t);
-    tcg_temp_free_i64(t);
-}
-
-static void gen_shl16_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-{
-    uint64_t mask = dup_const(MO_16, 0xffff << shift);
-    TCGv_i64 t = tcg_temp_new_i64();
-
-    tcg_gen_shli_i64(t, a, shift);
-    tcg_gen_andi_i64(t, t, mask);
-    tcg_gen_andi_i64(d, d, ~mask);
-    tcg_gen_or_i64(d, d, t);
-    tcg_temp_free_i64(t);
-}
-
-static void gen_shl32_ins_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
-{
-    tcg_gen_deposit_i32(d, d, a, shift, 32 - shift);
-}
-
-static void gen_shl64_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
-{
-    tcg_gen_deposit_i64(d, d, a, shift, 64 - shift);
-}
-
-static void gen_shl_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
-{
-    uint64_t mask = (1ull << sh) - 1;
-    TCGv_vec t = tcg_temp_new_vec_matching(d);
-    TCGv_vec m = tcg_temp_new_vec_matching(d);
-
-    tcg_gen_dupi_vec(vece, m, mask);
-    tcg_gen_shli_vec(vece, t, a, sh);
-    tcg_gen_and_vec(vece, d, d, m);
-    tcg_gen_or_vec(vece, d, d, t);
-
-    tcg_temp_free_vec(t);
-    tcg_temp_free_vec(m);
-}
-
 /* SHL/SLI - Vector shift left */
 static void handle_vec_simd_shli(DisasContext *s, bool is_q, bool insert,
                                  int immh, int immb, int opcode, int rn, int rd)
 {
-    static const GVecGen2i shi_op[4] = {
-        { .fni8 = gen_shl8_ins_i64,
-          .fniv = gen_shl_ins_vec,
-          .opc = INDEX_op_shli_vec,
-          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-          .load_dest = true,
-          .vece = MO_8 },
-        { .fni8 = gen_shl16_ins_i64,
-          .fniv = gen_shl_ins_vec,
-          .opc = INDEX_op_shli_vec,
-          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-          .load_dest = true,
-          .vece = MO_16 },
-        { .fni4 = gen_shl32_ins_i32,
-          .fniv = gen_shl_ins_vec,
-          .opc = INDEX_op_shli_vec,
-          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-          .load_dest = true,
-          .vece = MO_32 },
-        { .fni8 = gen_shl64_ins_i64,
-          .fniv = gen_shl_ins_vec,
-          .opc = INDEX_op_shli_vec,
-          .prefer_i64 = TCG_TARGET_REG_BITS == 64,
-          .load_dest = true,
-          .vece = MO_64 },
-    };
     int size = 32 - clz32(immh) - 1;
     int immhb = immh << 3 | immb;
     int shift = immhb - (8 << size);
@@ -XXX,XX +XXX,XX @@ static void handle_vec_simd_shli(DisasContext *s, bool is_q, bool insert,
     }
 
     if (insert) {
-        gen_gvec_op2i(s, is_q, rd, rn, shift, &shi_op[size]);
+        gen_gvec_op2i(s, is_q, rd, rn, shift, &sli_op[size]);
     } else {
         gen_gvec_fn2i(s, is_q, rd, rn, shift, tcg_gen_gvec_shli, size);
     }
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ const GVecGen2i usra_op[4] = {
       .vece = MO_64, },
 };
 
+static void gen_shr8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+{
+    uint64_t mask = dup_const(MO_8, 0xff >> shift);
+    TCGv_i64 t = tcg_temp_new_i64();
+
+    tcg_gen_shri_i64(t, a, shift);
+    tcg_gen_andi_i64(t, t, mask);
+    tcg_gen_andi_i64(d, d, ~mask);
+    tcg_gen_or_i64(d, d, t);
+    tcg_temp_free_i64(t);
+}
+
+static void gen_shr16_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+{
+    uint64_t mask = dup_const(MO_16, 0xffff >> shift);
+    TCGv_i64 t = tcg_temp_new_i64();
+
+    tcg_gen_shri_i64(t, a, shift);
+    tcg_gen_andi_i64(t, t, mask);
+    tcg_gen_andi_i64(d, d, ~mask);
+    tcg_gen_or_i64(d, d, t);
+    tcg_temp_free_i64(t);
+}
+
+static void gen_shr32_ins_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
+{
+    tcg_gen_shri_i32(a, a, shift);
+    tcg_gen_deposit_i32(d, d, a, 0, 32 - shift);
+}
+
+static void gen_shr64_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+{
+    tcg_gen_shri_i64(a, a, shift);
+    tcg_gen_deposit_i64(d, d, a, 0, 64 - shift);
+}
+
+static void gen_shr_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
+{
+    if (sh == 0) {
+        tcg_gen_mov_vec(d, a);
+    } else {
+        TCGv_vec t = tcg_temp_new_vec_matching(d);
+        TCGv_vec m = tcg_temp_new_vec_matching(d);
+
+        tcg_gen_dupi_vec(vece, m, MAKE_64BIT_MASK((8 << vece) - sh, sh));
+        tcg_gen_shri_vec(vece, t, a, sh);
+        tcg_gen_and_vec(vece, d, d, m);
+        tcg_gen_or_vec(vece, d, d, t);
+
+        tcg_temp_free_vec(t);
+        tcg_temp_free_vec(m);
+    }
+}
+
+const GVecGen2i sri_op[4] = {
+    { .fni8 = gen_shr8_ins_i64,
+      .fniv = gen_shr_ins_vec,
+      .load_dest = true,
+      .opc = INDEX_op_shri_vec,
+      .vece = MO_8 },
+    { .fni8 = gen_shr16_ins_i64,
+      .fniv = gen_shr_ins_vec,
+      .load_dest = true,
+      .opc = INDEX_op_shri_vec,
+      .vece = MO_16 },
+    { .fni4 = gen_shr32_ins_i32,
+      .fniv = gen_shr_ins_vec,
+      .load_dest = true,
+      .opc = INDEX_op_shri_vec,
+      .vece = MO_32 },
+    { .fni8 = gen_shr64_ins_i64,
+      .fniv = gen_shr_ins_vec,
+      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
+      .load_dest = true,
+      .opc = INDEX_op_shri_vec,
+      .vece = MO_64 },
+};
+
+static void gen_shl8_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+{
+    uint64_t mask = dup_const(MO_8, 0xff << shift);
+    TCGv_i64 t = tcg_temp_new_i64();
+
+    tcg_gen_shli_i64(t, a, shift);
+    tcg_gen_andi_i64(t, t, mask);
+    tcg_gen_andi_i64(d, d, ~mask);
+    tcg_gen_or_i64(d, d, t);
+    tcg_temp_free_i64(t);
+}
+
+static void gen_shl16_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+{
+    uint64_t mask = dup_const(MO_16, 0xffff << shift);
+    TCGv_i64 t = tcg_temp_new_i64();
+
+    tcg_gen_shli_i64(t, a, shift);
+    tcg_gen_andi_i64(t, t, mask);
+    tcg_gen_andi_i64(d, d, ~mask);
+    tcg_gen_or_i64(d, d, t);
+    tcg_temp_free_i64(t);
+}
+
+static void gen_shl32_ins_i32(TCGv_i32 d, TCGv_i32 a, int32_t shift)
+{
+    tcg_gen_deposit_i32(d, d, a, shift, 32 - shift);
+}
+
+static void gen_shl64_ins_i64(TCGv_i64 d, TCGv_i64 a, int64_t shift)
+{
+    tcg_gen_deposit_i64(d, d, a, shift, 64 - shift);
+}
+
+static void gen_shl_ins_vec(unsigned vece, TCGv_vec d, TCGv_vec a, int64_t sh)
+{
+    if (sh == 0) {
+        tcg_gen_mov_vec(d, a);
+    } else {
+        TCGv_vec t = tcg_temp_new_vec_matching(d);
+        TCGv_vec m = tcg_temp_new_vec_matching(d);
+
+        tcg_gen_dupi_vec(vece, m, MAKE_64BIT_MASK(0, sh));
+        tcg_gen_shli_vec(vece, t, a, sh);
+        tcg_gen_and_vec(vece, d, d, m);
+        tcg_gen_or_vec(vece, d, d, t);
+
+        tcg_temp_free_vec(t);
+        tcg_temp_free_vec(m);
+    }
+}
+
+const GVecGen2i sli_op[4] = {
+    { .fni8 = gen_shl8_ins_i64,
+      .fniv = gen_shl_ins_vec,
+      .load_dest = true,
+      .opc = INDEX_op_shli_vec,
+      .vece = MO_8 },
+    { .fni8 = gen_shl16_ins_i64,
+      .fniv = gen_shl_ins_vec,
+      .load_dest = true,
+      .opc = INDEX_op_shli_vec,
+      .vece = MO_16 },
+    { .fni4 = gen_shl32_ins_i32,
+      .fniv = gen_shl_ins_vec,
+      .load_dest = true,
+      .opc = INDEX_op_shli_vec,
+      .vece = MO_32 },
+    { .fni8 = gen_shl64_ins_i64,
+      .fniv = gen_shl_ins_vec,
+      .prefer_i64 = TCG_TARGET_REG_BITS == 64,
+      .load_dest = true,
+      .opc = INDEX_op_shli_vec,
+      .vece = MO_64 },
+};
+
 /* Translate a NEON data processing instruction.  Return nonzero if the
    instruction is invalid.
    We process data in a mixture of 32-bit and 64-bit chunks.
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
     int pairwise;
     int u;
     int vec_size;
-    uint32_t imm, mask;
+    uint32_t imm;
     TCGv_i32 tmp, tmp2, tmp3, tmp4, tmp5;
     TCGv_ptr ptr1, ptr2, ptr3;
     TCGv_i64 tmp64;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                     }
                     return 0;
 
+                case 4: /* VSRI */
+                    if (!u) {
+                        return 1;
+                    }
+                    /* Right shift comes here negative.  */
+                    shift = -shift;
+                    /* Shift out of range leaves destination unchanged.  */
+                    if (shift < 8 << size) {
+                        tcg_gen_gvec_2i(rd_ofs, rm_ofs, vec_size, vec_size,
+                                        shift, &sri_op[size]);
+                    }
+                    return 0;
+
                 case 5: /* VSHL, VSLI */
-                    if (!u) { /* VSHL */
+                    if (u) { /* VSLI */
+                        /* Shift out of range leaves destination unchanged.  */
+                        if (shift < 8 << size) {
+                            tcg_gen_gvec_2i(rd_ofs, rm_ofs, vec_size,
+                                            vec_size, shift, &sli_op[size]);
+                        }
+                    } else { /* VSHL */
                         /* Shifts larger than the element size are
                          * architecturally valid and results in zero.
                          */
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                             tcg_gen_gvec_shli(size, rd_ofs, rm_ofs, shift,
                                               vec_size, vec_size);
                         }
-                        return 0;
                     }
-                    break;
+                    return 0;
                 }
 
                 if (size == 3) {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                             else
                                 gen_helper_neon_rshl_s64(cpu_V0, cpu_V0, cpu_V1);
                             break;
-                        case 4: /* VSRI */
-                        case 5: /* VSHL, VSLI */
-                            gen_helper_neon_shl_u64(cpu_V0, cpu_V0, cpu_V1);
-                            break;
                         case 6: /* VQSHLU */
                             gen_helper_neon_qshlu_s64(cpu_V0, cpu_env,
                                                       cpu_V0, cpu_V1);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                             /* Accumulate.  */
                             neon_load_reg64(cpu_V1, rd + pass);
                             tcg_gen_add_i64(cpu_V0, cpu_V0, cpu_V1);
-                        } else if (op == 4 || (op == 5 && u)) {
-                            /* Insert */
-                            neon_load_reg64(cpu_V1, rd + pass);
-                            uint64_t mask;
-                            if (shift < -63 || shift > 63) {
-                                mask = 0;
-                            } else {
-                                if (op == 4) {
-                                    mask = 0xffffffffffffffffull >> -shift;
-                                } else {
-                                    mask = 0xffffffffffffffffull << shift;
-                                }
-                            }
-                            tcg_gen_andi_i64(cpu_V1, cpu_V1, ~mask);
-                            tcg_gen_or_i64(cpu_V0, cpu_V0, cpu_V1);
                         }
                         neon_store_reg64(cpu_V0, rd + pass);
                     } else { /* size < 3 */
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                         case 3: /* VRSRA */
                             GEN_NEON_INTEGER_OP(rshl);
                             break;
-                        case 4: /* VSRI */
-                        case 5: /* VSHL, VSLI */
-                            switch (size) {
-                            case 0: gen_helper_neon_shl_u8(tmp, tmp, tmp2); break;
-                            case 1: gen_helper_neon_shl_u16(tmp, tmp, tmp2); break;
-                            case 2: gen_helper_neon_shl_u32(tmp, tmp, tmp2); break;
-                            default: abort();
-                            }
-                            break;
                         case 6: /* VQSHLU */
                             switch (size) {
                             case 0:
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
                             tmp2 = neon_load_reg(rd, pass);
                             gen_neon_add(size, tmp, tmp2);
                             tcg_temp_free_i32(tmp2);
-                        } else if (op == 4 || (op == 5 && u)) {
-                            /* Insert */
-                            switch (size) {
-                            case 0:
-                                if (op == 4)
-                                    mask = 0xff >> -shift;
-                                else
-                                    mask = (uint8_t)(0xff << shift);
-                                mask |= mask << 8;
-                                mask |= mask << 16;
-                                break;
-                            case 1:
-                                if (op == 4)
-                                    mask = 0xffff >> -shift;
-                                else
-                                    mask = (uint16_t)(0xffff << shift);
-                                mask |= mask << 16;
-                                break;
-                            case 2:
-                                if (shift < -31 || shift > 31) {
-                                    mask = 0;
-                                } else {
-                                    if (op == 4)
-                                        mask = 0xffffffffu >> -shift;
-                                    else
-                                        mask = 0xffffffffu << shift;
-                                }
-                                break;
-                            default:
-                                abort();
-                            }
-                            tmp2 = neon_load_reg(rd, pass);
-                            tcg_gen_andi_i32(tmp, tmp, mask);
-                            tcg_gen_andi_i32(tmp2, tmp2, ~mask);
-                            tcg_gen_or_i32(tmp, tmp, tmp2);
-                            tcg_temp_free_i32(tmp2);
                         }
                         neon_store_reg(rd, pass, tmp);
                     }
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Move mla_op and mls_op expanders from translate-a64.c.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-16-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.h     |   2 +
 target/arm/translate-a64.c | 106 -----------------------------
 target/arm/translate.c     | 134 ++++++++++++++++++++++++++++++++-----
 3 files changed, 120 insertions(+), 122 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Move cmtst_op expanders from translate-a64.c.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-17-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.h     |  2 +
 target/arm/translate-a64.c | 38 ------------------
 target/arm/translate.c     | 81 +++++++++++++++++++++++++++-----------
 3 files changed, 60 insertions(+), 61 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-18-richard.henderson@linaro.org
[PMM: added parens in ?: expression]
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 81 ++++++++++++++----------------------------
 1 file changed, 26 insertions(+), 55 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void gen_vfp_msr(TCGv_i32 tmp)
     tcg_temp_free_i32(tmp);
 }
 
-static void gen_neon_dup_u8(TCGv_i32 var, int shift)
-{
-    TCGv_i32 tmp = tcg_temp_new_i32();
-    if (shift)
-        tcg_gen_shri_i32(var, var, shift);
-    tcg_gen_ext8u_i32(var, var);
-    tcg_gen_shli_i32(tmp, var, 8);
-    tcg_gen_or_i32(var, var, tmp);
-    tcg_gen_shli_i32(tmp, var, 16);
-    tcg_gen_or_i32(var, var, tmp);
-    tcg_temp_free_i32(tmp);
-}
-
 static void gen_neon_dup_low16(TCGv_i32 var)
 {
     TCGv_i32 tmp = tcg_temp_new_i32();
@@ -XXX,XX +XXX,XX @@ static void gen_neon_dup_high16(TCGv_i32 var)
     tcg_temp_free_i32(tmp);
 }
 
-static TCGv_i32 gen_load_and_replicate(DisasContext *s, TCGv_i32 addr, int size)
-{
-    /* Load a single Neon element and replicate into a 32 bit TCG reg */
-    TCGv_i32 tmp = tcg_temp_new_i32();
-    switch (size) {
-    case 0:
-        gen_aa32_ld8u(s, tmp, addr, get_mem_index(s));
-        gen_neon_dup_u8(tmp, 0);
-        break;
-    case 1:
-        gen_aa32_ld16u(s, tmp, addr, get_mem_index(s));
-        gen_neon_dup_low16(tmp);
-        break;
-    case 2:
-        gen_aa32_ld32u(s, tmp, addr, get_mem_index(s));
-        break;
-    default: /* Avoid compiler warnings.  */
-        abort();
-    }
-    return tmp;
-}
-
 static int handle_vsel(uint32_t insn, uint32_t rd, uint32_t rn, uint32_t rm,
                        uint32_t dp)
 {
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
     int load;
     int shift;
     int n;
+    int vec_size;
     TCGv_i32 addr;
     TCGv_i32 tmp;
     TCGv_i32 tmp2;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
             }
             addr = tcg_temp_new_i32();
             load_reg_var(s, addr, rn);
-            if (nregs == 1) {
-                /* VLD1 to all lanes: bit 5 indicates how many Dregs to write */
-                tmp = gen_load_and_replicate(s, addr, size);
-                tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd, 0));
-                tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd, 1));
-                if (insn & (1 << 5)) {
-                    tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd + 1, 0));
-                    tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd + 1, 1));
-                }
-                tcg_temp_free_i32(tmp);
-            } else {
-                /* VLD2/3/4 to all lanes: bit 5 indicates register stride */
-                stride = (insn & (1 << 5)) ? 2 : 1;
-                for (reg = 0; reg < nregs; reg++) {
-                    tmp = gen_load_and_replicate(s, addr, size);
-                    tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd, 0));
-                    tcg_gen_st_i32(tmp, cpu_env, neon_reg_offset(rd, 1));
-                    tcg_temp_free_i32(tmp);
-                    tcg_gen_addi_i32(addr, addr, 1 << size);
-                    rd += stride;
+
+            /* VLD1 to all lanes: bit 5 indicates how many Dregs to write.
+             * VLD2/3/4 to all lanes: bit 5 indicates register stride.
+             */
+            stride = (insn & (1 << 5)) ? 2 : 1;
+            vec_size = nregs == 1 ? stride * 8 : 8;
+
+            tmp = tcg_temp_new_i32();
+            for (reg = 0; reg < nregs; reg++) {
+                gen_aa32_ld_i32(s, tmp, addr, get_mem_index(s),
+                                s->be_data | size);
+                if ((rd & 1) && vec_size == 16) {
+                    /* We cannot write 16 bytes at once because the
+                     * destination is unaligned.
+                     */
+                    tcg_gen_gvec_dup_i32(size, neon_reg_offset(rd, 0),
+                                         8, 8, tmp);
+                    tcg_gen_gvec_mov(0, neon_reg_offset(rd + 1, 0),
+                                     neon_reg_offset(rd, 0), 8, 8);
+                } else {
+                    tcg_gen_gvec_dup_i32(size, neon_reg_offset(rd, 0),
+                                         vec_size, vec_size, tmp);
                 }
+                tcg_gen_addi_i32(addr, addr, 1 << size);
+                rd += stride;
             }
+            tcg_temp_free_i32(tmp);
             tcg_temp_free_i32(addr);
             stride = (1 << size) * nregs;
         } else {
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Instead of shifts and masks, use direct loads and stores from the neon
register file.  Mirror the iteration structure of the ARM pseudocode
more closely.  Correct the parameters of the VLD2 A2 insn.

Note that this includes a bugfix for handling of the insn
"VLD2 (multiple 2-element structures)" -- we were using an
incorrect stride value.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-19-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 170 ++++++++++++++++++-----------------------
 1 file changed, 74 insertions(+), 96 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static TCGv_i32 neon_load_reg(int reg, int pass)
     return tmp;
 }
 
+static void neon_load_element64(TCGv_i64 var, int reg, int ele, TCGMemOp mop)
+{
+    long offset = neon_element_offset(reg, ele, mop & MO_SIZE);
+
+    switch (mop) {
+    case MO_UB:
+        tcg_gen_ld8u_i64(var, cpu_env, offset);
+        break;
+    case MO_UW:
+        tcg_gen_ld16u_i64(var, cpu_env, offset);
+        break;
+    case MO_UL:
+        tcg_gen_ld32u_i64(var, cpu_env, offset);
+        break;
+    case MO_Q:
+        tcg_gen_ld_i64(var, cpu_env, offset);
+        break;
+    default:
+        g_assert_not_reached();
+    }
+}
+
 static void neon_store_reg(int reg, int pass, TCGv_i32 var)
 {
     tcg_gen_st_i32(var, cpu_env, neon_reg_offset(reg, pass));
     tcg_temp_free_i32(var);
 }
 
+static void neon_store_element64(int reg, int ele, TCGMemOp size, TCGv_i64 var)
+{
+    long offset = neon_element_offset(reg, ele, size);
+
+    switch (size) {
+    case MO_8:
+        tcg_gen_st8_i64(var, cpu_env, offset);
+        break;
+    case MO_16:
+        tcg_gen_st16_i64(var, cpu_env, offset);
+        break;
+    case MO_32:
+        tcg_gen_st32_i64(var, cpu_env, offset);
+        break;
+    case MO_64:
+        tcg_gen_st_i64(var, cpu_env, offset);
+        break;
+    default:
+        g_assert_not_reached();
+    }
+}
+
 static inline void neon_load_reg64(TCGv_i64 var, int reg)
 {
     tcg_gen_ld_i64(var, cpu_env, vfp_reg_offset(1, reg));
@@ -XXX,XX +XXX,XX @@ static struct {
     int interleave;
     int spacing;
 } const neon_ls_element_type[11] = {
-    {4, 4, 1},
-    {4, 4, 2},
+    {1, 4, 1},
+    {1, 4, 2},
     {4, 1, 1},
-    {4, 2, 1},
-    {3, 3, 1},
-    {3, 3, 2},
+    {2, 2, 2},
+    {1, 3, 1},
+    {1, 3, 2},
     {3, 1, 1},
     {1, 1, 1},
-    {2, 2, 1},
-    {2, 2, 2},
+    {1, 2, 1},
+    {1, 2, 2},
     {2, 1, 1}
 };
 
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
     int shift;
     int n;
     int vec_size;
+    int mmu_idx;
+    TCGMemOp endian;
     TCGv_i32 addr;
     TCGv_i32 tmp;
     TCGv_i32 tmp2;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
     rn = (insn >> 16) & 0xf;
     rm = insn & 0xf;
     load = (insn & (1 << 21)) != 0;
+    endian = s->be_data;
+    mmu_idx = get_mem_index(s);
     if ((insn & (1 << 23)) == 0) {
         /* Load store all elements.  */
         op = (insn >> 8) & 0xf;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
         nregs = neon_ls_element_type[op].nregs;
         interleave = neon_ls_element_type[op].interleave;
         spacing = neon_ls_element_type[op].spacing;
-        if (size == 3 && (interleave | spacing) != 1)
+        if (size == 3 && (interleave | spacing) != 1) {
             return 1;
+        }
+        tmp64 = tcg_temp_new_i64();
         addr = tcg_temp_new_i32();
+        tmp2 = tcg_const_i32(1 << size);
         load_reg_var(s, addr, rn);
-        stride = (1 << size) * interleave;
         for (reg = 0; reg < nregs; reg++) {
-            if (interleave > 2 || (interleave == 2 && nregs == 2)) {
-                load_reg_var(s, addr, rn);
-                tcg_gen_addi_i32(addr, addr, (1 << size) * reg);
-            } else if (interleave == 2 && nregs == 4 && reg == 2) {
-                load_reg_var(s, addr, rn);
-                tcg_gen_addi_i32(addr, addr, 1 << size);
-            }
-            if (size == 3) {
-                tmp64 = tcg_temp_new_i64();
-                if (load) {
-                    gen_aa32_ld64(s, tmp64, addr, get_mem_index(s));
-                    neon_store_reg64(tmp64, rd);
-                } else {
-                    neon_load_reg64(tmp64, rd);
-                    gen_aa32_st64(s, tmp64, addr, get_mem_index(s));
-                }
-                tcg_temp_free_i64(tmp64);
-                tcg_gen_addi_i32(addr, addr, stride);
-            } else {
-                for (pass = 0; pass < 2; pass++) {
-                    if (size == 2) {
-                        if (load) {
-                            tmp = tcg_temp_new_i32();
-                            gen_aa32_ld32u(s, tmp, addr, get_mem_index(s));
-                            neon_store_reg(rd, pass, tmp);
-                        } else {
-                            tmp = neon_load_reg(rd, pass);
-                            gen_aa32_st32(s, tmp, addr, get_mem_index(s));
-                            tcg_temp_free_i32(tmp);
-                        }
-                        tcg_gen_addi_i32(addr, addr, stride);
-                    } else if (size == 1) {
-                        if (load) {
-                            tmp = tcg_temp_new_i32();
-                            gen_aa32_ld16u(s, tmp, addr, get_mem_index(s));
-                            tcg_gen_addi_i32(addr, addr, stride);
-                            tmp2 = tcg_temp_new_i32();
-                            gen_aa32_ld16u(s, tmp2, addr, get_mem_index(s));
-                            tcg_gen_addi_i32(addr, addr, stride);
-                            tcg_gen_shli_i32(tmp2, tmp2, 16);
-                            tcg_gen_or_i32(tmp, tmp, tmp2);
-                            tcg_temp_free_i32(tmp2);
-                            neon_store_reg(rd, pass, tmp);
-                        } else {
-                            tmp = neon_load_reg(rd, pass);
-                            tmp2 = tcg_temp_new_i32();
-                            tcg_gen_shri_i32(tmp2, tmp, 16);
-                            gen_aa32_st16(s, tmp, addr, get_mem_index(s));
-                            tcg_temp_free_i32(tmp);
-                            tcg_gen_addi_i32(addr, addr, stride);
-                            gen_aa32_st16(s, tmp2, addr, get_mem_index(s));
-                            tcg_temp_free_i32(tmp2);
-                            tcg_gen_addi_i32(addr, addr, stride);
-                        }
-                    } else /* size == 0 */ {
-                        if (load) {
-                            tmp2 = NULL;
-                            for (n = 0; n < 4; n++) {
-                                tmp = tcg_temp_new_i32();
-                                gen_aa32_ld8u(s, tmp, addr, get_mem_index(s));
-                                tcg_gen_addi_i32(addr, addr, stride);
-                                if (n == 0) {
-                                    tmp2 = tmp;
-                                } else {
-                                    tcg_gen_shli_i32(tmp, tmp, n * 8);
-                                    tcg_gen_or_i32(tmp2, tmp2, tmp);
-                                    tcg_temp_free_i32(tmp);
-                                }
-                            }
-                            neon_store_reg(rd, pass, tmp2);
-                        } else {
-                            tmp2 = neon_load_reg(rd, pass);
-                            for (n = 0; n < 4; n++) {
-                                tmp = tcg_temp_new_i32();
-                                if (n == 0) {
-                                    tcg_gen_mov_i32(tmp, tmp2);
-                                } else {
-                                    tcg_gen_shri_i32(tmp, tmp2, n * 8);
-                                }
-                                gen_aa32_st8(s, tmp, addr, get_mem_index(s));
-                                tcg_temp_free_i32(tmp);
-                                tcg_gen_addi_i32(addr, addr, stride);
-                            }
-                            tcg_temp_free_i32(tmp2);
-                        }
+            for (n = 0; n < 8 >> size; n++) {
+                int xs;
+                for (xs = 0; xs < interleave; xs++) {
+                    int tt = rd + reg + spacing * xs;
+
+                    if (load) {
+                        gen_aa32_ld_i64(s, tmp64, addr, mmu_idx, endian | size);
+                        neon_store_element64(tt, n, size, tmp64);
+                    } else {
+                        neon_load_element64(tmp64, tt, n, size);
+                        gen_aa32_st_i64(s, tmp64, addr, mmu_idx, endian | size);
                     }
+                    tcg_gen_add_i32(addr, addr, tmp2);
                 }
             }
-            rd += spacing;
         }
         tcg_temp_free_i32(addr);
-        stride = nregs * 8;
+        tcg_temp_free_i32(tmp2);
+        tcg_temp_free_i64(tmp64);
+        stride = nregs * interleave * 8;
     } else {
         size = (insn >> 10) & 3;
         if (size == 3) {
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

For a sequence of loads or stores from a single register,
little-endian operations can be promoted to an 8-byte op.
This can reduce the number of operations by a factor of 8.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-20-richard.henderson@linaro.org
Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 10 ++++++++++
 1 file changed, 10 insertions(+)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_ls_insn(DisasContext *s, uint32_t insn)
         if (size == 3 && (interleave | spacing) != 1) {
             return 1;
         }
+        /* For our purposes, bytes are always little-endian.  */
+        if (size == 0) {
+            endian = MO_LE;
+        }
+        /* Consecutive little-endian elements from a single register
+         * can be promoted to a larger little-endian operation.
+         */
+        if (interleave == 1 && endian == MO_LE) {
+            size = 3;
+        }
         tmp64 = tcg_temp_new_i64();
         addr = tcg_temp_new_i32();
         tmp2 = tcg_const_i32(1 << size);
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Instead of shifts and masks, use direct loads and stores from
the neon register file.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20181011205206.3552-21-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.c | 92 +++++++++++++++++++++++-------------------
 1 file changed, 50 insertions(+), 42 deletions(-)

From: "Edgar E. Iglesias" <edgar.iglesias@xilinx.com>

Announce the availability of the various priority queues.
This fixes an issue where guest kernels would miss to
configure secondary queues due to inproper feature bits.

Signed-off-by: Edgar E. Iglesias <edgar.iglesias@xilinx.com>
Message-id: 20181017213932.19973-2-edgar.iglesias@gmail.com
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/net/cadence_gem.c | 8 +++++++-
 1 file changed, 7 insertions(+), 1 deletion(-)

diff --git a/hw/net/cadence_gem.c b/hw/net/cadence_gem.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/net/cadence_gem.c
+++ b/hw/net/cadence_gem.c
@@ -XXX,XX +XXX,XX @@ static void gem_reset(DeviceState *d)
     int i;
     CadenceGEMState *s = CADENCE_GEM(d);
     const uint8_t *a;
+    uint32_t queues_mask = 0;
 
     DB_PRINT("\n");
 
@@ -XXX,XX +XXX,XX @@ static void gem_reset(DeviceState *d)
     s->regs[GEM_DESCONF] = 0x02500111;
     s->regs[GEM_DESCONF2] = 0x2ab13fff;
     s->regs[GEM_DESCONF5] = 0x002f2045;
-    s->regs[GEM_DESCONF6] = 0x00000200;
+    s->regs[GEM_DESCONF6] = 0x0;
+
+    if (s->num_priority_queues > 1) {
+        queues_mask = MAKE_64BIT_MASK(1, s->num_priority_queues - 1);
+        s->regs[GEM_DESCONF6] |= queues_mask;
+    }
 
     /* Set MAC address */
     a = &s->conf.macaddr.a[0];
-- 
2.19.1

From: "Edgar E. Iglesias" <edgar.iglesias@xilinx.com>

Announce 64bit addressing support.

Reviewed-by: Alistair Francis <alistair.francis@wdc.com>
Signed-off-by: Edgar E. Iglesias <edgar.iglesias@xilinx.com>
Message-id: 20181017213932.19973-3-edgar.iglesias@gmail.com
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/net/cadence_gem.c | 3 ++-
 1 file changed, 2 insertions(+), 1 deletion(-)

diff --git a/hw/net/cadence_gem.c b/hw/net/cadence_gem.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/net/cadence_gem.c
+++ b/hw/net/cadence_gem.c
@@ -XXX,XX +XXX,XX @@
 #define GEM_DESCONF4      (0x0000028C/4)
 #define GEM_DESCONF5      (0x00000290/4)
 #define GEM_DESCONF6      (0x00000294/4)
+#define GEM_DESCONF6_64B_MASK (1U << 23)
 #define GEM_DESCONF7      (0x00000298/4)
 
 #define GEM_INT_Q1_STATUS               (0x00000400 / 4)
@@ -XXX,XX +XXX,XX @@ static void gem_reset(DeviceState *d)
     s->regs[GEM_DESCONF] = 0x02500111;
     s->regs[GEM_DESCONF2] = 0x2ab13fff;
     s->regs[GEM_DESCONF5] = 0x002f2045;
-    s->regs[GEM_DESCONF6] = 0x0;
+    s->regs[GEM_DESCONF6] = GEM_DESCONF6_64B_MASK;
 
     if (s->num_priority_queues > 1) {
         queues_mask = MAKE_64BIT_MASK(1, s->num_priority_queues - 1);
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

The EL3 version of this register does not include an ASID,
and so the tlb_flush performed by vmsa_ttbr_write is not needed.

Reviewed-by: Aaron Lindsay <aaron@os.amperecomputing.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20181019015617.22583-2-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper.c | 2 +-
 1 file changed, 1 insertion(+), 1 deletion(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo el3_cp_reginfo[] = {
       .fieldoffset = offsetof(CPUARMState, cp15.mvbar) },
     { .name = "TTBR0_EL3", .state = ARM_CP_STATE_AA64,
       .opc0 = 3, .opc1 = 6, .crn = 2, .crm = 0, .opc2 = 0,
-      .access = PL3_RW, .writefn = vmsa_ttbr_write, .resetvalue = 0,
+      .access = PL3_RW, .resetvalue = 0,
       .fieldoffset = offsetof(CPUARMState, cp15.ttbr0_el[3]) },
     { .name = "TCR_EL3", .state = ARM_CP_STATE_AA64,
       .opc0 = 3, .opc1 = 6, .crn = 2, .crm = 0, .opc2 = 2,
-- 
2.19.1

From: Richard Henderson <richard.henderson@linaro.org>

Since QEMU does not implement ASIDs, changes to the ASID must flush the
tlb.  However, if the ASID does not change there is no reason to flush.

In testing a boot of the Ubuntu installer to the first menu, this reduces
the number of flushes by 30%, or nearly 600k instances.

Reviewed-by: Aaron Lindsay <aaron@os.amperecomputing.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Message-id: 20181019015617.22583-3-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper.c | 8 +++-----
 1 file changed, 3 insertions(+), 5 deletions(-)

Massive pullreq but almost all of that is RTH's SVE
refactoring patchset. The other interesting thing here is
the fix for compiling on aarch64 macos.

thanks
-- PMM

The following changes since commit f7a1ea403e0282a7f57edd4298c4f65f24165da5:

Merge tag 'misc-pull-request' of gitlab.com:marcandre.lureau/qemu into staging (2022-05-29 16:34:56 -0700)

are available in the Git repository at:

https://git.linaro.org/people/pmaydell/qemu-arm.git tags/pull-target-arm-20220530

for you to fetch changes up to b1071174d2a2ab371082b7d4b5f19e98edc61ac6:

target/arm: Remove aa64_sve check from before disas_sve (2022-05-30 17:05:12 +0100)

----------------------------------------------------------------
target-arm queue:
 * docs/system/arm: Add FEAT_HCX to list of emulated features
 * target/arm/hvf: Include missing "cpregs.h"
 * hw/sd/allwinner-sdhost: report FIFO water level as 1 when data ready
 * SVE: refactor to use TRANS/TRANS_FEAT macros and push
   SVE feature check down to individual insn level

----------------------------------------------------------------
Icenowy Zheng (1):
      hw/sd/allwinner-sdhost: report FIFO water level as 1 when data ready

Peter Maydell (1):
      docs/system/arm: Add FEAT_HCX to list of emulated features

Philippe Mathieu-Daudé (1):
      target/arm/hvf: Include missing "cpregs.h"

Richard Henderson (114):
      target/arm: Introduce TRANS, TRANS_FEAT
      target/arm: Move null function and sve check into gen_gvec_ool_zz
      target/arm: Use TRANS_FEAT for gen_gvec_ool_zz
      target/arm: Move null function and sve check into gen_gvec_ool_zzz
      target/arm: Introduce gen_gvec_ool_arg_zzz
      target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zzz
      target/arm: Use TRANS_FEAT for do_sve2_zzz_ool
      target/arm: Move null function and sve check into gen_gvec_ool_zzzz
      target/arm: Use TRANS_FEAT for gen_gvec_ool_zzzz
      target/arm: Introduce gen_gvec_ool_arg_zzzz
      target/arm: Use TRANS_FEAT for do_sve2_zzzz_ool
      target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zzzz
      target/arm: Rename do_zzxz_ool to gen_gvec_ool_arg_zzxz
      target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zzxz
      target/arm: Use TRANS_FEAT for do_sve2_zzz_data
      target/arm: Use TRANS_FEAT for do_sve2_zzzz_data
      target/arm: Use TRANS_FEAT for do_sve2_zzw_data
      target/arm: Use TRANS_FEAT for USDOT_zzzz
      target/arm: Move null function and sve check into gen_gvec_ool_zzp
      target/arm: Introduce gen_gvec_ool_arg_zpz
      target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zpz
      target/arm: Use TRANS_FEAT for do_sve2_zpz_data
      target/arm: Rename do_zpzi_ool to gen_gvec_ool_arg_zpzi
      target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zpzi
      target/arm: Move null function and sve check into gen_gvec_ool_zzzp
      target/arm: Introduce gen_gvec_ool_arg_zpzz
      target/arm: Use TRANS_FEAT for gen_gvec_ool_arg_zpzz
      target/arm: Use TRANS_FEAT for do_sve2_zpzz_ool
      target/arm: Merge gen_gvec_fn_zz into do_mov_z
      target/arm: Move null function and sve check into gen_gvec_fn_zzz
      target/arm: Rename do_zzz_fn to gen_gvec_fn_arg_zzz
      target/arm: More use of gen_gvec_fn_arg_zzz
      target/arm: Use TRANS_FEAT for gen_gvec_fn_arg_zzz
      target/arm: Use TRANS_FEAT for do_sve2_fn_zzz
      target/arm: Use TRANS_FEAT for RAX1
      target/arm: Introduce gen_gvec_fn_arg_zzzz
      target/arm: Use TRANS_FEAT for do_sve2_zzzz_fn
      target/arm: Introduce gen_gvec_fn_zzi
      target/arm: Use TRANS_FEAT for do_zz_dbm
      target/arm: Hoist sve access check through do_sel_z
      target/arm: Introduce gen_gvec_fn_arg_zzi
      target/arm: Use TRANS_FEAT for do_sve2_fn2i
      target/arm: Use TRANS_FEAT for do_vpz_ool
      target/arm: Use TRANS_FEAT for do_shift_imm
      target/arm: Introduce do_shift_zpzi
      target/arm: Use TRANS_FEAT for do_shift_zpzi
      target/arm: Use TRANS_FEAT for do_zpzzz_ool
      target/arm: Move sve check into do_index
      target/arm: Use TRANS_FEAT for do_index
      target/arm: Use TRANS_FEAT for do_adr
      target/arm: Use TRANS_FEAT for do_predset
      target/arm: Use TRANS_FEAT for RDFFR, WRFFR
      target/arm: Use TRANS_FEAT for do_pfirst_pnext
      target/arm: Use TRANS_FEAT for do_EXT
      target/arm: Use TRANS_FEAT for do_perm_pred3
      target/arm: Use TRANS_FEAT for do_perm_pred2
      target/arm: Move sve zip high_ofs into simd_data
      target/arm: Use gen_gvec_ool_arg_zzz for do_zip, do_zip_q
      target/arm: Use TRANS_FEAT for do_zip, do_zip_q
      target/arm: Use TRANS_FEAT for do_clast_vector
      target/arm: Use TRANS_FEAT for do_clast_fp
      target/arm: Use TRANS_FEAT for do_clast_general
      target/arm: Use TRANS_FEAT for do_last_fp
      target/arm: Use TRANS_FEAT for do_last_general
      target/arm: Use TRANS_FEAT for SPLICE
      target/arm: Use TRANS_FEAT for do_ppzz_flags
      target/arm: Use TRANS_FEAT for do_sve2_ppzz_flags
      target/arm: Use TRANS_FEAT for do_ppzi_flags
      target/arm: Use TRANS_FEAT for do_brk2, do_brk3
      target/arm: Use TRANS_FEAT for MUL_zzi
      target/arm: Reject dup_i w/ shifted byte early
      target/arm: Reject add/sub w/ shifted byte early
      target/arm: Reject copy w/ shifted byte early
      target/arm: Use TRANS_FEAT for ADD_zzi
      target/arm: Use TRANS_FEAT for do_zzi_sat
      target/arm: Use TRANS_FEAT for do_zzi_ool
      target/arm: Introduce gen_gvec_{ptr,fpst}_zzzz
      target/arm: Use TRANS_FEAT for FMMLA
      target/arm: Move sve check into gen_gvec_fn_ppp
      target/arm: Implement NOT (prediates) alias
      target/arm: Use TRANS_FEAT for SEL_zpzz
      target/arm: Use TRANS_FEAT for MOVPRFX
      target/arm: Use TRANS_FEAT for FMLA
      target/arm: Use TRANS_FEAT for BFMLA
      target/arm: Rename do_zzz_fp to gen_gvec_ool_fpst_arg_zzz
      target/arm: Use TRANS_FEAT for DO_FP3
      target/arm: Use TRANS_FEAT for FMUL_zzx
      target/arm: Use TRANS_FEAT for FTMAD
      target/arm: Move null function and sve check into do_reduce
      target/arm: Use TRANS_FEAT for do_reduce
      target/arm: Use TRANS_FEAT for FRECPE, FRSQRTE
      target/arm: Expand frint_fns for MO_8
      target/arm: Rename do_zpz_ptr to gen_gvec_ool_fpst_arg_zpz
      target/arm: Move null function and sve check into do_frint_mode
      target/arm: Use TRANS_FEAT for do_frint_mode
      target/arm: Use TRANS_FEAT for FLOGB
      target/arm: Use TRANS_FEAT for do_ppz_fp
      target/arm: Rename do_zpzz_ptr to gen_gvec_fpst_arg_zpzz
      target/arm: Use TRANS_FEAT for gen_gvec_fpst_arg_zpzz
      target/arm: Use TRANS_FEAT for FCADD
      target/arm: Introduce gen_gvec_fpst_zzzzp
      target/arm: Use TRANS_FEAT for gen_gvec_fpst_zzzzp
      target/arm: Move null function and sve check into do_fp_imm
      target/arm: Use TRANS_FEAT for DO_FP_IMM
      target/arm: Use TRANS_FEAT for DO_FPCMP
      target/arm: Remove assert in trans_FCMLA_zzxz
      target/arm: Use TRANS_FEAT for FCMLA_zzxz
      target/arm: Use TRANS_FEAT for do_narrow_extract
      target/arm: Use TRANS_FEAT for do_shll_tb
      target/arm: Use TRANS_FEAT for do_shr_narrow
      target/arm: Use TRANS_FEAT for do_FMLAL_zzzw
      target/arm: Use TRANS_FEAT for do_FMLAL_zzxw
      target/arm: Add sve feature check for remaining trans_* functions
      target/arm: Remove aa64_sve check from before disas_sve

In commit 5814d587fe861fe9 we added support for emulating
FEAT_HCX (Support for the HCRX_EL2 register). However we
forgot to add it to the list in emulated.rst. Correct the
omission.

Fixes: 5814d587fe861fe9 ("target/arm: Enable FEAT_HCX for -cpu max")
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220520084320.424166-1-peter.maydell@linaro.org
---
 docs/system/arm/emulation.rst | 1 +
 1 file changed, 1 insertion(+)

diff --git a/docs/system/arm/emulation.rst b/docs/system/arm/emulation.rst
index XXXXXXX..XXXXXXX 100644
--- a/docs/system/arm/emulation.rst
+++ b/docs/system/arm/emulation.rst
@@ -XXX,XX +XXX,XX @@ the following architecture extensions:
 - FEAT_FRINTTS (Floating-point to integer instructions)
 - FEAT_FlagM (Flag manipulation instructions v2)
 - FEAT_FlagM2 (Enhancements to flag manipulation instructions)
+- FEAT_HCX (Support for the HCRX_EL2 register)
 - FEAT_HPDS (Hierarchical permission disables)
 - FEAT_I8MM (AArch64 Int8 matrix multiplication instructions)
 - FEAT_IDST (ID space trap handling)
-- 
2.25.1

From: Philippe Mathieu-Daudé <f4bug@amsat.org>

Fix when building HVF on macOS Aarch64:

target/arm/hvf/hvf.c:586:15: error: unknown type name 'ARMCPRegInfo'; did you mean 'ARMCPUInfo'?
          const ARMCPRegInfo *ri;
                ^~~~~~~~~~~~
                ARMCPUInfo
  target/arm/cpu-qom.h:38:3: note: 'ARMCPUInfo' declared here
  } ARMCPUInfo;
    ^
  target/arm/hvf/hvf.c:589:14: error: implicit declaration of function 'get_arm_cp_reginfo' is invalid in C99 [-Werror,-Wimplicit-function-declaration]
          ri = get_arm_cp_reginfo(arm_cpu->cp_regs, key);
               ^
  target/arm/hvf/hvf.c:589:12: warning: incompatible integer to pointer conversion assigning to 'const ARMCPUInfo *' (aka 'const struct ARMCPUInfo *') from 'int' [-Wint-conversion]
          ri = get_arm_cp_reginfo(arm_cpu->cp_regs, key);
             ^ ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~
  target/arm/hvf/hvf.c:591:26: error: no member named 'type' in 'struct ARMCPUInfo'
              assert(!(ri->type & ARM_CP_NO_RAW));
                       ~~  ^
  /Library/Developer/CommandLineTools/SDKs/MacOSX.sdk/usr/include/assert.h:99:25: note: expanded from macro 'assert'
      (__builtin_expect(!(e), 0) ? __assert_rtn(__func__, __ASSERT_FILE_NAME, __LINE__, #e) : (void)0)
                          ^
  target/arm/hvf/hvf.c:591:33: error: use of undeclared identifier 'ARM_CP_NO_RAW'
              assert(!(ri->type & ARM_CP_NO_RAW));
                                  ^
  1 warning and 4 errors generated.

Fixes: cf7c6d1004 ("target/arm: Split out cpregs.h")
Reported-by: Duncan Bayne <duncan@bayne.id.au>
Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220525161926.34233-1-philmd@fungible.com
Resolves: https://gitlab.com/qemu-project/qemu/-/issues/1029
Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/hvf/hvf.c | 1 +
 1 file changed, 1 insertion(+)

diff --git a/target/arm/hvf/hvf.c b/target/arm/hvf/hvf.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/hvf/hvf.c
+++ b/target/arm/hvf/hvf.c
@@ -XXX,XX +XXX,XX @@
 #include "sysemu/hvf_int.h"
 #include "sysemu/hw_accel.h"
 #include "hvf_arm.h"
+#include "cpregs.h"
 
 #include <mach/mach_time.h>
 
-- 
2.25.1

From: Icenowy Zheng <uwu@icenowy.me>

U-Boot queries the FIFO water level to reduce checking status register
when doing PIO SD card operation.

Report a FIFO water level of 1 when data is ready, to prevent the code
from trying to read 0 words from the FIFO each time.

Signed-off-by: Icenowy Zheng <uwu@icenowy.me>
Message-id: 20220520124200.2112699-1-uwu@icenowy.me
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/sd/allwinner-sdhost.c | 7 +++++++
 1 file changed, 7 insertions(+)

diff --git a/hw/sd/allwinner-sdhost.c b/hw/sd/allwinner-sdhost.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/sd/allwinner-sdhost.c
+++ b/hw/sd/allwinner-sdhost.c
@@ -XXX,XX +XXX,XX @@ enum {
 };
 
 enum {
+    SD_STAR_FIFO_EMPTY      = (1 << 2),
     SD_STAR_CARD_PRESENT    = (1 << 8),
+    SD_STAR_FIFO_LEVEL_1    = (1 << 17),
 };
 
 enum {
@@ -XXX,XX +XXX,XX @@ static uint64_t allwinner_sdhost_read(void *opaque, hwaddr offset,
         break;
     case REG_SD_STAR:      /* Status */
         res = s->status;
+        if (sdbus_data_ready(&s->sdbus)) {
+            res |= SD_STAR_FIFO_LEVEL_1;
+        } else {
+            res |= SD_STAR_FIFO_EMPTY;
+        }
         break;
     case REG_SD_FWLR:      /* FIFO Water Level */
         res = s->fifo_wlevel;
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Steal the idea for these leaf function expanders from PowerPC.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-2-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.h | 11 +++++++++++
 1 file changed, 11 insertions(+)

diff --git a/target/arm/translate.h b/target/arm/translate.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.h
+++ b/target/arm/translate.h
@@ -XXX,XX +XXX,XX @@ static inline MemOp finalize_memop(DisasContext *s, MemOp opc)
  */
 uint64_t asimd_imm_const(uint32_t imm, int cmode, int op);
 
+/*
+ * Helpers for implementing sets of trans_* functions.
+ * Defer the implementation of NAME to FUNC, with optional extra arguments.
+ */
+#define TRANS(NAME, FUNC, ...) \
+    static bool trans_##NAME(DisasContext *s, arg_##NAME *a) \
+    { return FUNC(s, __VA_ARGS__); }
+#define TRANS_FEAT(NAME, FEAT, FUNC, ...) \
+    static bool trans_##NAME(DisasContext *s, arg_##NAME *a) \
+    { return dc_isar_feature(FEAT, s) && FUNC(s, __VA_ARGS__); }
+
 #endif /* TARGET_ARM_TRANSLATE_H */
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-3-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 36 +++++++++++++++---------------------
 1 file changed, 15 insertions(+), 21 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static int pred_gvec_reg_size(DisasContext *s)
 }
 
 /* Invoke an out-of-line helper on 2 Zregs. */
-static void gen_gvec_ool_zz(DisasContext *s, gen_helper_gvec_2 *fn,
+static bool gen_gvec_ool_zz(DisasContext *s, gen_helper_gvec_2 *fn,
                             int rd, int rn, int data)
 {
-    unsigned vsz = vec_full_reg_size(s);
-    tcg_gen_gvec_2_ool(vec_full_reg_offset(s, rd),
-                       vec_full_reg_offset(s, rn),
-                       vsz, vsz, data, fn);
+    if (fn == NULL) {
+        return false;
+    }
+    if (sve_access_check(s)) {
+        unsigned vsz = vec_full_reg_size(s);
+        tcg_gen_gvec_2_ool(vec_full_reg_offset(s, rd),
+                           vec_full_reg_offset(s, rn),
+                           vsz, vsz, data, fn);
+    }
+    return true;
 }
 
 /* Invoke an out-of-line helper on 3 Zregs. */
@@ -XXX,XX +XXX,XX @@ static bool trans_FEXPA(DisasContext *s, arg_rr_esz *a)
         gen_helper_sve_fexpa_s,
         gen_helper_sve_fexpa_d,
     };
-    if (a->esz == 0) {
-        return false;
-    }
-    if (sve_access_check(s)) {
-        gen_gvec_ool_zz(s, fns[a->esz], a->rd, a->rn, 0);
-    }
-    return true;
+    return gen_gvec_ool_zz(s, fns[a->esz], a->rd, a->rn, 0);
 }
 
 static bool trans_FTSSEL(DisasContext *s, arg_rrr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_REV_v(DisasContext *s, arg_rr_esz *a)
         gen_helper_sve_rev_b, gen_helper_sve_rev_h,
         gen_helper_sve_rev_s, gen_helper_sve_rev_d
     };
-
-    if (sve_access_check(s)) {
-        gen_gvec_ool_zz(s, fns[a->esz], a->rd, a->rn, 0);
-    }
-    return true;
+    return gen_gvec_ool_zz(s, fns[a->esz], a->rd, a->rn, 0);
 }
 
 static bool trans_TBL(DisasContext *s, arg_rrr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_AESMC(DisasContext *s, arg_AESMC *a)
     if (!dc_isar_feature(aa64_sve2_aes, s)) {
         return false;
     }
-    if (sve_access_check(s)) {
-        gen_gvec_ool_zz(s, gen_helper_crypto_aesmc, a->rd, a->rd, a->decrypt);
-    }
-    return true;
+    return gen_gvec_ool_zz(s, gen_helper_crypto_aesmc,
+                           a->rd, a->rd, a->decrypt);
 }
 
 static bool do_aese(DisasContext *s, arg_rrr_esz *a, bool decrypt)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions using gen_gvec_ool_zz to TRANS_FEAT.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-4-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 39 +++++++++++++-------------------------
 1 file changed, 13 insertions(+), 26 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_ADR_u32(DisasContext *s, arg_rrri *a)
  *** SVE Integer Misc - Unpredicated Group
  */
 
-static bool trans_FEXPA(DisasContext *s, arg_rr_esz *a)
-{
-    static gen_helper_gvec_2 * const fns[4] = {
-        NULL,
-        gen_helper_sve_fexpa_h,
-        gen_helper_sve_fexpa_s,
-        gen_helper_sve_fexpa_d,
-    };
-    return gen_gvec_ool_zz(s, fns[a->esz], a->rd, a->rn, 0);
-}
+static gen_helper_gvec_2 * const fexpa_fns[4] = {
+    NULL,                   gen_helper_sve_fexpa_h,
+    gen_helper_sve_fexpa_s, gen_helper_sve_fexpa_d,
+};
+TRANS_FEAT(FEXPA, aa64_sve, gen_gvec_ool_zz,
+           fexpa_fns[a->esz], a->rd, a->rn, 0)
 
 static bool trans_FTSSEL(DisasContext *s, arg_rrr_esz *a)
 {
@@ -XXX,XX +XXX,XX @@ static bool trans_INSR_r(DisasContext *s, arg_rrr_esz *a)
     return true;
 }
 
-static bool trans_REV_v(DisasContext *s, arg_rr_esz *a)
-{
-    static gen_helper_gvec_2 * const fns[4] = {
-        gen_helper_sve_rev_b, gen_helper_sve_rev_h,
-        gen_helper_sve_rev_s, gen_helper_sve_rev_d
-    };
-    return gen_gvec_ool_zz(s, fns[a->esz], a->rd, a->rn, 0);
-}
+static gen_helper_gvec_2 * const rev_fns[4] = {
+    gen_helper_sve_rev_b, gen_helper_sve_rev_h,
+    gen_helper_sve_rev_s, gen_helper_sve_rev_d
+};
+TRANS_FEAT(REV_v, aa64_sve, gen_gvec_ool_zz, rev_fns[a->esz], a->rd, a->rn, 0)
 
 static bool trans_TBL(DisasContext *s, arg_rrr_esz *a)
 {
@@ -XXX,XX +XXX,XX @@ static bool trans_USDOT_zzzz(DisasContext *s, arg_USDOT_zzzz *a)
     return true;
 }
 
-static bool trans_AESMC(DisasContext *s, arg_AESMC *a)
-{
-    if (!dc_isar_feature(aa64_sve2_aes, s)) {
-        return false;
-    }
-    return gen_gvec_ool_zz(s, gen_helper_crypto_aesmc,
-                           a->rd, a->rd, a->decrypt);
-}
+TRANS_FEAT(AESMC, aa64_sve2_aes, gen_gvec_ool_zz,
+           gen_helper_crypto_aesmc, a->rd, a->rd, a->decrypt)
 
 static bool do_aese(DisasContext *s, arg_rrr_esz *a, bool decrypt)
 {
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-5-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 74 ++++++++++++--------------------------
 1 file changed, 23 insertions(+), 51 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Use gen_gvec_ool_arg_zzz instead of gen_gvec_ool_zzz
when the arguments come from arg_rrr_esz.
Replaces do_zzw_ool and do_zzz_data_ool.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-6-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 48 +++++++++++++++++---------------------
 1 file changed, 21 insertions(+), 27 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions using
gen_gvec_ool_arg_zzz to TRANS_FEAT.

Remove trivial wrappers do_aese, do_sm4.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-7-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 165 ++++++++++---------------------------
 1 file changed, 45 insertions(+), 120 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_LSL_zzi(DisasContext *s, arg_rri_esz *a)
 }
 
 #define DO_ZZW(NAME, name) \
-static bool trans_##NAME##_zzw(DisasContext *s, arg_rrr_esz *a)           \
-{                                                                         \
-    static gen_helper_gvec_3 * const fns[4] = {                           \
+    static gen_helper_gvec_3 * const name##_zzw_fns[4] = {                \
         gen_helper_sve_##name##_zzw_b, gen_helper_sve_##name##_zzw_h,     \
         gen_helper_sve_##name##_zzw_s, NULL                               \
     };                                                                    \
-    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, 0);                    \
-}
+    TRANS_FEAT(NAME, aa64_sve, gen_gvec_ool_arg_zzz,                      \
+               name##_zzw_fns[a->esz], a, 0)
 
-DO_ZZW(ASR, asr)
-DO_ZZW(LSR, lsr)
-DO_ZZW(LSL, lsl)
+DO_ZZW(ASR_zzw, asr)
+DO_ZZW(LSR_zzw, lsr)
+DO_ZZW(LSL_zzw, lsl)
 
 #undef DO_ZZW
 
@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_2 * const fexpa_fns[4] = {
 TRANS_FEAT(FEXPA, aa64_sve, gen_gvec_ool_zz,
            fexpa_fns[a->esz], a->rd, a->rn, 0)
 
-static bool trans_FTSSEL(DisasContext *s, arg_rrr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        NULL,
-        gen_helper_sve_ftssel_h,
-        gen_helper_sve_ftssel_s,
-        gen_helper_sve_ftssel_d,
-    };
-    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, 0);
-}
+static gen_helper_gvec_3 * const ftssel_fns[4] = {
+    NULL,                    gen_helper_sve_ftssel_h,
+    gen_helper_sve_ftssel_s, gen_helper_sve_ftssel_d,
+};
+TRANS_FEAT(FTSSEL, aa64_sve, gen_gvec_ool_arg_zzz, ftssel_fns[a->esz], a, 0)
 
 /*
  *** SVE Predicate Logical Operations Group
@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_2 * const rev_fns[4] = {
 };
 TRANS_FEAT(REV_v, aa64_sve, gen_gvec_ool_zz, rev_fns[a->esz], a->rd, a->rn, 0)
 
-static bool trans_TBL(DisasContext *s, arg_rrr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_sve_tbl_b, gen_helper_sve_tbl_h,
-        gen_helper_sve_tbl_s, gen_helper_sve_tbl_d
-    };
-    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, 0);
-}
+static gen_helper_gvec_3 * const sve_tbl_fns[4] = {
+    gen_helper_sve_tbl_b, gen_helper_sve_tbl_h,
+    gen_helper_sve_tbl_s, gen_helper_sve_tbl_d
+};
+TRANS_FEAT(TBL, aa64_sve, gen_gvec_ool_arg_zzz, sve_tbl_fns[a->esz], a, 0)
 
 static bool trans_TBL_sve2(DisasContext *s, arg_rrr_esz *a)
 {
@@ -XXX,XX +XXX,XX @@ static bool trans_TBL_sve2(DisasContext *s, arg_rrr_esz *a)
     return true;
 }
 
-static bool trans_TBX(DisasContext *s, arg_rrr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_sve2_tbx_b, gen_helper_sve2_tbx_h,
-        gen_helper_sve2_tbx_s, gen_helper_sve2_tbx_d
-    };
-
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, 0);
-}
+static gen_helper_gvec_3 * const tbx_fns[4] = {
+    gen_helper_sve2_tbx_b, gen_helper_sve2_tbx_h,
+    gen_helper_sve2_tbx_s, gen_helper_sve2_tbx_d
+};
+TRANS_FEAT(TBX, aa64_sve2, gen_gvec_ool_arg_zzz, tbx_fns[a->esz], a, 0)
 
 static bool trans_UNPK(DisasContext *s, arg_UNPK *a)
 {
@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_3 * const uzp_fns[4] = {
     gen_helper_sve_uzp_s, gen_helper_sve_uzp_d,
 };
 
-static bool trans_UZP1_z(DisasContext *s, arg_rrr_esz *a)
-{
-    return gen_gvec_ool_arg_zzz(s, uzp_fns[a->esz], a, 0);
-}
+TRANS_FEAT(UZP1_z, aa64_sve, gen_gvec_ool_arg_zzz,
+           uzp_fns[a->esz], a, 0)
+TRANS_FEAT(UZP2_z, aa64_sve, gen_gvec_ool_arg_zzz,
+           uzp_fns[a->esz], a, 1 << a->esz)
 
-static bool trans_UZP2_z(DisasContext *s, arg_rrr_esz *a)
-{
-    return gen_gvec_ool_arg_zzz(s, uzp_fns[a->esz], a, 1 << a->esz);
-}
-
-static bool trans_UZP1_q(DisasContext *s, arg_rrr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve_f64mm, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zzz(s, gen_helper_sve2_uzp_q, a, 0);
-}
-
-static bool trans_UZP2_q(DisasContext *s, arg_rrr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve_f64mm, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zzz(s, gen_helper_sve2_uzp_q, a, 16);
-}
+TRANS_FEAT(UZP1_q, aa64_sve_f64mm, gen_gvec_ool_arg_zzz,
+           gen_helper_sve2_uzp_q, a, 0)
+TRANS_FEAT(UZP2_q, aa64_sve_f64mm, gen_gvec_ool_arg_zzz,
+           gen_helper_sve2_uzp_q, a, 16)
 
 static gen_helper_gvec_3 * const trn_fns[4] = {
     gen_helper_sve_trn_b, gen_helper_sve_trn_h,
     gen_helper_sve_trn_s, gen_helper_sve_trn_d,
 };
 
-static bool trans_TRN1_z(DisasContext *s, arg_rrr_esz *a)
-{
-    return gen_gvec_ool_arg_zzz(s, trn_fns[a->esz], a, 0);
-}
+TRANS_FEAT(TRN1_z, aa64_sve, gen_gvec_ool_arg_zzz,
+           trn_fns[a->esz], a, 0)
+TRANS_FEAT(TRN2_z, aa64_sve, gen_gvec_ool_arg_zzz,
+           trn_fns[a->esz], a, 1 << a->esz)
 
-static bool trans_TRN2_z(DisasContext *s, arg_rrr_esz *a)
-{
-    return gen_gvec_ool_arg_zzz(s, trn_fns[a->esz], a, 1 << a->esz);
-}
-
-static bool trans_TRN1_q(DisasContext *s, arg_rrr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve_f64mm, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zzz(s, gen_helper_sve2_trn_q, a, 0);
-}
-
-static bool trans_TRN2_q(DisasContext *s, arg_rrr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve_f64mm, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zzz(s, gen_helper_sve2_trn_q, a, 16);
-}
+TRANS_FEAT(TRN1_q, aa64_sve_f64mm, gen_gvec_ool_arg_zzz,
+           gen_helper_sve2_trn_q, a, 0)
+TRANS_FEAT(TRN2_q, aa64_sve_f64mm, gen_gvec_ool_arg_zzz,
+           gen_helper_sve2_trn_q, a, 16)
 
 /*
  *** SVE Permute Vector - Predicated Group
@@ -XXX,XX +XXX,XX @@ static bool trans_USDOT_zzzz(DisasContext *s, arg_USDOT_zzzz *a)
 TRANS_FEAT(AESMC, aa64_sve2_aes, gen_gvec_ool_zz,
            gen_helper_crypto_aesmc, a->rd, a->rd, a->decrypt)
 
-static bool do_aese(DisasContext *s, arg_rrr_esz *a, bool decrypt)
-{
-    if (!dc_isar_feature(aa64_sve2_aes, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zzz(s, gen_helper_crypto_aese, a, decrypt);
-}
+TRANS_FEAT(AESE, aa64_sve2_aes, gen_gvec_ool_arg_zzz,
+           gen_helper_crypto_aese, a, false)
+TRANS_FEAT(AESD, aa64_sve2_aes, gen_gvec_ool_arg_zzz,
+           gen_helper_crypto_aese, a, true)
 
-static bool trans_AESE(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_aese(s, a, false);
-}
-
-static bool trans_AESD(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_aese(s, a, true);
-}
-
-static bool do_sm4(DisasContext *s, arg_rrr_esz *a, gen_helper_gvec_3 *fn)
-{
-    if (!dc_isar_feature(aa64_sve2_sm4, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zzz(s, fn, a, 0);
-}
-
-static bool trans_SM4E(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_sm4(s, a, gen_helper_crypto_sm4e);
-}
-
-static bool trans_SM4EKEY(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_sm4(s, a, gen_helper_crypto_sm4ekey);
-}
+TRANS_FEAT(SM4E, aa64_sve2_sm4, gen_gvec_ool_arg_zzz,
+           gen_helper_crypto_sm4e, a, 0)
+TRANS_FEAT(SM4EKEY, aa64_sve2_sm4, gen_gvec_ool_arg_zzz,
+           gen_helper_crypto_sm4ekey, a, 0)
 
 static bool trans_RAX1(DisasContext *s, arg_rrr_esz *a)
 {
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions using do_sve2_zzz_ool
to use TRANS_FEAT and gen_gvec_ool_arg_zzz.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-8-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 88 ++++++++++++++------------------------
 1 file changed, 31 insertions(+), 57 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_MUL_zzz(DisasContext *s, arg_rrr_esz *a)
     return true;
 }
 
-static bool do_sve2_zzz_ool(DisasContext *s, arg_rrr_esz *a,
-                            gen_helper_gvec_3 *fn)
-{
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zzz(s, fn, a, 0);
-}
+static gen_helper_gvec_3 * const smulh_zzz_fns[4] = {
+    gen_helper_gvec_smulh_b, gen_helper_gvec_smulh_h,
+    gen_helper_gvec_smulh_s, gen_helper_gvec_smulh_d,
+};
+TRANS_FEAT(SMULH_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
+           smulh_zzz_fns[a->esz], a, 0)
 
-static bool trans_SMULH_zzz(DisasContext *s, arg_rrr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_gvec_smulh_b, gen_helper_gvec_smulh_h,
-        gen_helper_gvec_smulh_s, gen_helper_gvec_smulh_d,
-    };
-    return do_sve2_zzz_ool(s, a, fns[a->esz]);
-}
+static gen_helper_gvec_3 * const umulh_zzz_fns[4] = {
+    gen_helper_gvec_umulh_b, gen_helper_gvec_umulh_h,
+    gen_helper_gvec_umulh_s, gen_helper_gvec_umulh_d,
+};
+TRANS_FEAT(UMULH_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
+           umulh_zzz_fns[a->esz], a, 0)
 
-static bool trans_UMULH_zzz(DisasContext *s, arg_rrr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_gvec_umulh_b, gen_helper_gvec_umulh_h,
-        gen_helper_gvec_umulh_s, gen_helper_gvec_umulh_d,
-    };
-    return do_sve2_zzz_ool(s, a, fns[a->esz]);
-}
+TRANS_FEAT(PMUL_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
+           gen_helper_gvec_pmul_b, a, 0)
 
-static bool trans_PMUL_zzz(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_sve2_zzz_ool(s, a, gen_helper_gvec_pmul_b);
-}
+static gen_helper_gvec_3 * const sqdmulh_zzz_fns[4] = {
+    gen_helper_sve2_sqdmulh_b, gen_helper_sve2_sqdmulh_h,
+    gen_helper_sve2_sqdmulh_s, gen_helper_sve2_sqdmulh_d,
+};
+TRANS_FEAT(SQDMULH_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
+           sqdmulh_zzz_fns[a->esz], a, 0)
 
-static bool trans_SQDMULH_zzz(DisasContext *s, arg_rrr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_sve2_sqdmulh_b, gen_helper_sve2_sqdmulh_h,
-        gen_helper_sve2_sqdmulh_s, gen_helper_sve2_sqdmulh_d,
-    };
-    return do_sve2_zzz_ool(s, a, fns[a->esz]);
-}
-
-static bool trans_SQRDMULH_zzz(DisasContext *s, arg_rrr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_sve2_sqrdmulh_b, gen_helper_sve2_sqrdmulh_h,
-        gen_helper_sve2_sqrdmulh_s, gen_helper_sve2_sqrdmulh_d,
-    };
-    return do_sve2_zzz_ool(s, a, fns[a->esz]);
-}
+static gen_helper_gvec_3 * const sqrdmulh_zzz_fns[4] = {
+    gen_helper_sve2_sqrdmulh_b, gen_helper_sve2_sqrdmulh_h,
+    gen_helper_sve2_sqrdmulh_s, gen_helper_sve2_sqrdmulh_d,
+};
+TRANS_FEAT(SQRDMULH_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
+           sqrdmulh_zzz_fns[a->esz], a, 0)
 
 /*
  * SVE2 Integer - Predicated
@@ -XXX,XX +XXX,XX @@ static bool trans_UQRSHRNT(DisasContext *s, arg_rri_esz *a)
 }
 
 #define DO_SVE2_ZZZ_NARROW(NAME, name)                                    \
-static bool trans_##NAME(DisasContext *s, arg_rrr_esz *a)                 \
-{                                                                         \
-    static gen_helper_gvec_3 * const fns[4] = {                           \
+    static gen_helper_gvec_3 * const name##_fns[4] = {                    \
         NULL,                       gen_helper_sve2_##name##_h,           \
         gen_helper_sve2_##name##_s, gen_helper_sve2_##name##_d,           \
     };                                                                    \
-    return do_sve2_zzz_ool(s, a, fns[a->esz]);                            \
-}
+    TRANS_FEAT(NAME, aa64_sve2, gen_gvec_ool_arg_zzz,                     \
+               name##_fns[a->esz], a, 0)
 
 DO_SVE2_ZZZ_NARROW(ADDHNB, addhnb)
 DO_SVE2_ZZZ_NARROW(ADDHNT, addhnt)
@@ -XXX,XX +XXX,XX @@ static bool trans_HISTCNT(DisasContext *s, arg_rprr_esz *a)
     return do_sve2_zpzz_ool(s, a, fns[a->esz - 2]);
 }
 
-static bool trans_HISTSEG(DisasContext *s, arg_rrr_esz *a)
-{
-    if (a->esz != 0) {
-        return false;
-    }
-    return do_sve2_zzz_ool(s, a, gen_helper_sve2_histseg);
-}
+TRANS_FEAT(HISTSEG, aa64_sve2, gen_gvec_ool_arg_zzz,
+           a->esz == 0 ? gen_helper_sve2_histseg : NULL, a, 0)
 
 static bool do_sve2_zpzz_fp(DisasContext *s, arg_rprr_esz *a,
                             gen_helper_gvec_4_ptr *fn)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-9-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 102 ++++++++++++++-----------------------
 1 file changed, 38 insertions(+), 64 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions directly using
gen_gvec_ool_zzzz to TRANS_FEAT.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-10-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 89 +++++++++++++-------------------------
 1 file changed, 29 insertions(+), 60 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_3 * const sve_tbl_fns[4] = {
 };
 TRANS_FEAT(TBL, aa64_sve, gen_gvec_ool_arg_zzz, sve_tbl_fns[a->esz], a, 0)
 
-static bool trans_TBL_sve2(DisasContext *s, arg_rrr_esz *a)
-{
-    static gen_helper_gvec_4 * const fns[4] = {
-        gen_helper_sve2_tbl_b, gen_helper_sve2_tbl_h,
-        gen_helper_sve2_tbl_s, gen_helper_sve2_tbl_d
-    };
-
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_ool_zzzz(s, fns[a->esz], a->rd, a->rn,
-                             (a->rn + 1) % 32, a->rm, 0);
-}
+static gen_helper_gvec_4 * const sve2_tbl_fns[4] = {
+    gen_helper_sve2_tbl_b, gen_helper_sve2_tbl_h,
+    gen_helper_sve2_tbl_s, gen_helper_sve2_tbl_d
+};
+TRANS_FEAT(TBL_sve2, aa64_sve2, gen_gvec_ool_zzzz, sve2_tbl_fns[a->esz],
+           a->rd, a->rn, (a->rn + 1) % 32, a->rm, 0)
 
 static gen_helper_gvec_3 * const tbx_fns[4] = {
     gen_helper_sve2_tbx_b, gen_helper_sve2_tbx_h,
@@ -XXX,XX +XXX,XX @@ DO_ZZI(UMIN, umin)
 
 #undef DO_ZZI
 
-static bool trans_DOT_zzzz(DisasContext *s, arg_DOT_zzzz *a)
-{
-    static gen_helper_gvec_4 * const fns[2][2] = {
-        { gen_helper_gvec_sdot_b, gen_helper_gvec_sdot_h },
-        { gen_helper_gvec_udot_b, gen_helper_gvec_udot_h }
-    };
-    return gen_gvec_ool_zzzz(s, fns[a->u][a->sz],
-                             a->rd, a->rn, a->rm, a->ra, 0);
-}
+static gen_helper_gvec_4 * const dot_fns[2][2] = {
+    { gen_helper_gvec_sdot_b, gen_helper_gvec_sdot_h },
+    { gen_helper_gvec_udot_b, gen_helper_gvec_udot_h }
+};
+TRANS_FEAT(DOT_zzzz, aa64_sve, gen_gvec_ool_zzzz,
+           dot_fns[a->u][a->sz], a->rd, a->rn, a->rm, a->ra, 0)
 
 /*
  * SVE Multiply - Indexed
@@ -XXX,XX +XXX,XX @@ static bool trans_UMLSLT_zzzw(DisasContext *s, arg_rrrr_esz *a)
     return do_umlsl_zzzw(s, a, true);
 }
 
-static bool trans_CMLA_zzzz(DisasContext *s, arg_CMLA_zzzz *a)
-{
-    static gen_helper_gvec_4 * const fns[] = {
-        gen_helper_sve2_cmla_zzzz_b, gen_helper_sve2_cmla_zzzz_h,
-        gen_helper_sve2_cmla_zzzz_s, gen_helper_sve2_cmla_zzzz_d,
-    };
+static gen_helper_gvec_4 * const cmla_fns[] = {
+    gen_helper_sve2_cmla_zzzz_b, gen_helper_sve2_cmla_zzzz_h,
+    gen_helper_sve2_cmla_zzzz_s, gen_helper_sve2_cmla_zzzz_d,
+};
+TRANS_FEAT(CMLA_zzzz, aa64_sve2, gen_gvec_ool_zzzz,
+           cmla_fns[a->esz], a->rd, a->rn, a->rm, a->ra, a->rot)
 
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_ool_zzzz(s, fns[a->esz], a->rd, a->rn,
-                             a->rm, a->ra, a->rot);
-}
+static gen_helper_gvec_4 * const cdot_fns[] = {
+    NULL, NULL, gen_helper_sve2_cdot_zzzz_s, gen_helper_sve2_cdot_zzzz_d
+};
+TRANS_FEAT(CDOT_zzzz, aa64_sve2, gen_gvec_ool_zzzz,
+           cdot_fns[a->esz], a->rd, a->rn, a->rm, a->ra, a->rot)
 
-static bool trans_CDOT_zzzz(DisasContext *s, arg_CMLA_zzzz *a)
-{
-    static gen_helper_gvec_4 * const fns[] = {
-        NULL, NULL, gen_helper_sve2_cdot_zzzz_s, gen_helper_sve2_cdot_zzzz_d
-    };
-
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_ool_zzzz(s, fns[a->esz], a->rd, a->rn,
-                             a->rm, a->ra, a->rot);
-}
-
-static bool trans_SQRDCMLAH_zzzz(DisasContext *s, arg_SQRDCMLAH_zzzz *a)
-{
-    static gen_helper_gvec_4 * const fns[] = {
-        gen_helper_sve2_sqrdcmlah_zzzz_b, gen_helper_sve2_sqrdcmlah_zzzz_h,
-        gen_helper_sve2_sqrdcmlah_zzzz_s, gen_helper_sve2_sqrdcmlah_zzzz_d,
-    };
-
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_ool_zzzz(s, fns[a->esz], a->rd, a->rn,
-                             a->rm, a->ra, a->rot);
-}
+static gen_helper_gvec_4 * const sqrdcmlah_fns[] = {
+    gen_helper_sve2_sqrdcmlah_zzzz_b, gen_helper_sve2_sqrdcmlah_zzzz_h,
+    gen_helper_sve2_sqrdcmlah_zzzz_s, gen_helper_sve2_sqrdcmlah_zzzz_d,
+};
+TRANS_FEAT(SQRDCMLAH_zzzz, aa64_sve2, gen_gvec_ool_zzzz,
+           sqrdcmlah_fns[a->esz], a->rd, a->rn, a->rm, a->ra, a->rot)
 
 static bool trans_USDOT_zzzz(DisasContext *s, arg_USDOT_zzzz *a)
 {
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Use gen_gvec_ool_arg_zzzz instead of gen_gvec_ool_zzzz
when the arguments come from arg_rrrr_esz.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-11-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 16 ++++++++++------
 1 file changed, 10 insertions(+), 6 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions using do_sve2_zzzz_ool
to use TRANS_FEAT and gen_gvec_ool_arg_zzzz.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-12-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 263 +++++++++++--------------------------
 1 file changed, 79 insertions(+), 184 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_SQCADD_rot270(DisasContext *s, arg_rrr_esz *a)
     return do_cadd(s, a, true, true);
 }
 
-static bool do_sve2_zzzz_ool(DisasContext *s, arg_rrrr_esz *a,
-                             gen_helper_gvec_4 *fn, int data)
-{
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zzzz(s, fn, a, data);
-}
+static gen_helper_gvec_4 * const sabal_fns[4] = {
+    NULL,                    gen_helper_sve2_sabal_h,
+    gen_helper_sve2_sabal_s, gen_helper_sve2_sabal_d,
+};
+TRANS_FEAT(SABALB, aa64_sve2, gen_gvec_ool_arg_zzzz, sabal_fns[a->esz], a, 0)
+TRANS_FEAT(SABALT, aa64_sve2, gen_gvec_ool_arg_zzzz, sabal_fns[a->esz], a, 1)
 
-static bool do_abal(DisasContext *s, arg_rrrr_esz *a, bool uns, bool sel)
-{
-    static gen_helper_gvec_4 * const fns[2][4] = {
-        { NULL,                    gen_helper_sve2_sabal_h,
-          gen_helper_sve2_sabal_s, gen_helper_sve2_sabal_d },
-        { NULL,                    gen_helper_sve2_uabal_h,
-          gen_helper_sve2_uabal_s, gen_helper_sve2_uabal_d },
-    };
-    return do_sve2_zzzz_ool(s, a, fns[uns][a->esz], sel);
-}
-
-static bool trans_SABALB(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_abal(s, a, false, false);
-}
-
-static bool trans_SABALT(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_abal(s, a, false, true);
-}
-
-static bool trans_UABALB(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_abal(s, a, true, false);
-}
-
-static bool trans_UABALT(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_abal(s, a, true, true);
-}
+static gen_helper_gvec_4 * const uabal_fns[4] = {
+    NULL,                    gen_helper_sve2_uabal_h,
+    gen_helper_sve2_uabal_s, gen_helper_sve2_uabal_d,
+};
+TRANS_FEAT(UABALB, aa64_sve2, gen_gvec_ool_arg_zzzz, uabal_fns[a->esz], a, 0)
+TRANS_FEAT(UABALT, aa64_sve2, gen_gvec_ool_arg_zzzz, uabal_fns[a->esz], a, 1)
 
 static bool do_adcl(DisasContext *s, arg_rrrr_esz *a, bool sel)
 {
@@ -XXX,XX +XXX,XX @@ static bool do_adcl(DisasContext *s, arg_rrrr_esz *a, bool sel)
      * Note that in this case the ESZ field encodes both size and sign.
      * Split out 'subtract' into bit 1 of the data field for the helper.
      */
-    return do_sve2_zzzz_ool(s, a, fns[a->esz & 1], (a->esz & 2) | sel);
+    return gen_gvec_ool_arg_zzzz(s, fns[a->esz & 1], a, (a->esz & 2) | sel);
 }
 
-static bool trans_ADCLB(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_adcl(s, a, false);
-}
-
-static bool trans_ADCLT(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_adcl(s, a, true);
-}
+TRANS_FEAT(ADCLB, aa64_sve2, do_adcl, a, false)
+TRANS_FEAT(ADCLT, aa64_sve2, do_adcl, a, true)
 
 static bool do_sve2_fn2i(DisasContext *s, arg_rri_esz *a, GVecGen2iFn *fn)
 {
@@ -XXX,XX +XXX,XX @@ static bool trans_FMMLA(DisasContext *s, arg_rrrr_esz *a)
     return true;
 }
 
-static bool do_sqdmlal_zzzw(DisasContext *s, arg_rrrr_esz *a,
-                            bool sel1, bool sel2)
-{
-    static gen_helper_gvec_4 * const fns[] = {
-        NULL,                           gen_helper_sve2_sqdmlal_zzzw_h,
-        gen_helper_sve2_sqdmlal_zzzw_s, gen_helper_sve2_sqdmlal_zzzw_d,
-    };
-    return do_sve2_zzzz_ool(s, a, fns[a->esz], (sel2 << 1) | sel1);
-}
+static gen_helper_gvec_4 * const sqdmlal_zzzw_fns[] = {
+    NULL,                           gen_helper_sve2_sqdmlal_zzzw_h,
+    gen_helper_sve2_sqdmlal_zzzw_s, gen_helper_sve2_sqdmlal_zzzw_d,
+};
+TRANS_FEAT(SQDMLALB_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
+           sqdmlal_zzzw_fns[a->esz], a, 0)
+TRANS_FEAT(SQDMLALT_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
+           sqdmlal_zzzw_fns[a->esz], a, 3)
+TRANS_FEAT(SQDMLALBT, aa64_sve2, gen_gvec_ool_arg_zzzz,
+           sqdmlal_zzzw_fns[a->esz], a, 2)
 
-static bool do_sqdmlsl_zzzw(DisasContext *s, arg_rrrr_esz *a,
-                            bool sel1, bool sel2)
-{
-    static gen_helper_gvec_4 * const fns[] = {
-        NULL,                           gen_helper_sve2_sqdmlsl_zzzw_h,
-        gen_helper_sve2_sqdmlsl_zzzw_s, gen_helper_sve2_sqdmlsl_zzzw_d,
-    };
-    return do_sve2_zzzz_ool(s, a, fns[a->esz], (sel2 << 1) | sel1);
-}
+static gen_helper_gvec_4 * const sqdmlsl_zzzw_fns[] = {
+    NULL,                           gen_helper_sve2_sqdmlsl_zzzw_h,
+    gen_helper_sve2_sqdmlsl_zzzw_s, gen_helper_sve2_sqdmlsl_zzzw_d,
+};
+TRANS_FEAT(SQDMLSLB_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
+           sqdmlsl_zzzw_fns[a->esz], a, 0)
+TRANS_FEAT(SQDMLSLT_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
+           sqdmlsl_zzzw_fns[a->esz], a, 3)
+TRANS_FEAT(SQDMLSLBT, aa64_sve2, gen_gvec_ool_arg_zzzz,
+           sqdmlsl_zzzw_fns[a->esz], a, 2)
 
-static bool trans_SQDMLALB_zzzw(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_sqdmlal_zzzw(s, a, false, false);
-}
+static gen_helper_gvec_4 * const sqrdmlah_fns[] = {
+    gen_helper_sve2_sqrdmlah_b, gen_helper_sve2_sqrdmlah_h,
+    gen_helper_sve2_sqrdmlah_s, gen_helper_sve2_sqrdmlah_d,
+};
+TRANS_FEAT(SQRDMLAH_zzzz, aa64_sve2, gen_gvec_ool_arg_zzzz,
+           sqrdmlah_fns[a->esz], a, 0)
 
-static bool trans_SQDMLALT_zzzw(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_sqdmlal_zzzw(s, a, true, true);
-}
+static gen_helper_gvec_4 * const sqrdmlsh_fns[] = {
+    gen_helper_sve2_sqrdmlsh_b, gen_helper_sve2_sqrdmlsh_h,
+    gen_helper_sve2_sqrdmlsh_s, gen_helper_sve2_sqrdmlsh_d,
+};
+TRANS_FEAT(SQRDMLSH_zzzz, aa64_sve2, gen_gvec_ool_arg_zzzz,
+           sqrdmlsh_fns[a->esz], a, 0)
 
-static bool trans_SQDMLALBT(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_sqdmlal_zzzw(s, a, false, true);
-}
+static gen_helper_gvec_4 * const smlal_zzzw_fns[] = {
+    NULL,                         gen_helper_sve2_smlal_zzzw_h,
+    gen_helper_sve2_smlal_zzzw_s, gen_helper_sve2_smlal_zzzw_d,
+};
+TRANS_FEAT(SMLALB_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
+           smlal_zzzw_fns[a->esz], a, 0)
+TRANS_FEAT(SMLALT_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
+           smlal_zzzw_fns[a->esz], a, 1)
 
-static bool trans_SQDMLSLB_zzzw(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_sqdmlsl_zzzw(s, a, false, false);
-}
+static gen_helper_gvec_4 * const umlal_zzzw_fns[] = {
+    NULL,                         gen_helper_sve2_umlal_zzzw_h,
+    gen_helper_sve2_umlal_zzzw_s, gen_helper_sve2_umlal_zzzw_d,
+};
+TRANS_FEAT(UMLALB_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
+           umlal_zzzw_fns[a->esz], a, 0)
+TRANS_FEAT(UMLALT_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
+           umlal_zzzw_fns[a->esz], a, 1)
 
-static bool trans_SQDMLSLT_zzzw(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_sqdmlsl_zzzw(s, a, true, true);
-}
+static gen_helper_gvec_4 * const smlsl_zzzw_fns[] = {
+    NULL,                         gen_helper_sve2_smlsl_zzzw_h,
+    gen_helper_sve2_smlsl_zzzw_s, gen_helper_sve2_smlsl_zzzw_d,
+};
+TRANS_FEAT(SMLSLB_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
+           smlsl_zzzw_fns[a->esz], a, 0)
+TRANS_FEAT(SMLSLT_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
+           smlsl_zzzw_fns[a->esz], a, 1)
 
-static bool trans_SQDMLSLBT(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_sqdmlsl_zzzw(s, a, false, true);
-}
-
-static bool trans_SQRDMLAH_zzzz(DisasContext *s, arg_rrrr_esz *a)
-{
-    static gen_helper_gvec_4 * const fns[] = {
-        gen_helper_sve2_sqrdmlah_b, gen_helper_sve2_sqrdmlah_h,
-        gen_helper_sve2_sqrdmlah_s, gen_helper_sve2_sqrdmlah_d,
-    };
-    return do_sve2_zzzz_ool(s, a, fns[a->esz], 0);
-}
-
-static bool trans_SQRDMLSH_zzzz(DisasContext *s, arg_rrrr_esz *a)
-{
-    static gen_helper_gvec_4 * const fns[] = {
-        gen_helper_sve2_sqrdmlsh_b, gen_helper_sve2_sqrdmlsh_h,
-        gen_helper_sve2_sqrdmlsh_s, gen_helper_sve2_sqrdmlsh_d,
-    };
-    return do_sve2_zzzz_ool(s, a, fns[a->esz], 0);
-}
-
-static bool do_smlal_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sel)
-{
-    static gen_helper_gvec_4 * const fns[] = {
-        NULL,                         gen_helper_sve2_smlal_zzzw_h,
-        gen_helper_sve2_smlal_zzzw_s, gen_helper_sve2_smlal_zzzw_d,
-    };
-    return do_sve2_zzzz_ool(s, a, fns[a->esz], sel);
-}
-
-static bool trans_SMLALB_zzzw(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_smlal_zzzw(s, a, false);
-}
-
-static bool trans_SMLALT_zzzw(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_smlal_zzzw(s, a, true);
-}
-
-static bool do_umlal_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sel)
-{
-    static gen_helper_gvec_4 * const fns[] = {
-        NULL,                         gen_helper_sve2_umlal_zzzw_h,
-        gen_helper_sve2_umlal_zzzw_s, gen_helper_sve2_umlal_zzzw_d,
-    };
-    return do_sve2_zzzz_ool(s, a, fns[a->esz], sel);
-}
-
-static bool trans_UMLALB_zzzw(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_umlal_zzzw(s, a, false);
-}
-
-static bool trans_UMLALT_zzzw(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_umlal_zzzw(s, a, true);
-}
-
-static bool do_smlsl_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sel)
-{
-    static gen_helper_gvec_4 * const fns[] = {
-        NULL,                         gen_helper_sve2_smlsl_zzzw_h,
-        gen_helper_sve2_smlsl_zzzw_s, gen_helper_sve2_smlsl_zzzw_d,
-    };
-    return do_sve2_zzzz_ool(s, a, fns[a->esz], sel);
-}
-
-static bool trans_SMLSLB_zzzw(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_smlsl_zzzw(s, a, false);
-}
-
-static bool trans_SMLSLT_zzzw(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_smlsl_zzzw(s, a, true);
-}
-
-static bool do_umlsl_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sel)
-{
-    static gen_helper_gvec_4 * const fns[] = {
-        NULL,                         gen_helper_sve2_umlsl_zzzw_h,
-        gen_helper_sve2_umlsl_zzzw_s, gen_helper_sve2_umlsl_zzzw_d,
-    };
-    return do_sve2_zzzz_ool(s, a, fns[a->esz], sel);
-}
-
-static bool trans_UMLSLB_zzzw(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_umlsl_zzzw(s, a, false);
-}
-
-static bool trans_UMLSLT_zzzw(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_umlsl_zzzw(s, a, true);
-}
+static gen_helper_gvec_4 * const umlsl_zzzw_fns[] = {
+    NULL,                         gen_helper_sve2_umlsl_zzzw_h,
+    gen_helper_sve2_umlsl_zzzw_s, gen_helper_sve2_umlsl_zzzw_d,
+};
+TRANS_FEAT(UMLSLB_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
+           umlsl_zzzw_fns[a->esz], a, 0)
+TRANS_FEAT(UMLSLT_zzzw, aa64_sve2, gen_gvec_ool_arg_zzzz,
+           umlsl_zzzw_fns[a->esz], a, 1)
 
 static gen_helper_gvec_4 * const cmla_fns[] = {
     gen_helper_sve2_cmla_zzzz_b, gen_helper_sve2_cmla_zzzz_h,
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions directly using
gen_gvec_ool_arg_zzzz to TRANS_FEAT.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-13-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 47 ++++++++------------------------------
 1 file changed, 10 insertions(+), 37 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_FMLSLT_zzxw(DisasContext *s, arg_rrxr_esz *a)
     return do_FMLAL_zzxw(s, a, true, true);
 }
 
-static bool do_i8mm_zzzz_ool(DisasContext *s, arg_rrrr_esz *a,
-                             gen_helper_gvec_4 *fn, int data)
-{
-    if (!dc_isar_feature(aa64_sve_i8mm, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zzzz(s, fn, a, data);
-}
+TRANS_FEAT(SMMLA, aa64_sve_i8mm, gen_gvec_ool_arg_zzzz,
+           gen_helper_gvec_smmla_b, a, 0)
+TRANS_FEAT(USMMLA, aa64_sve_i8mm, gen_gvec_ool_arg_zzzz,
+           gen_helper_gvec_usmmla_b, a, 0)
+TRANS_FEAT(UMMLA, aa64_sve_i8mm, gen_gvec_ool_arg_zzzz,
+           gen_helper_gvec_ummla_b, a, 0)
 
-static bool trans_SMMLA(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_i8mm_zzzz_ool(s, a, gen_helper_gvec_smmla_b, 0);
-}
-
-static bool trans_USMMLA(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_i8mm_zzzz_ool(s, a, gen_helper_gvec_usmmla_b, 0);
-}
-
-static bool trans_UMMLA(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_i8mm_zzzz_ool(s, a, gen_helper_gvec_ummla_b, 0);
-}
-
-static bool trans_BFDOT_zzzz(DisasContext *s, arg_rrrr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve_bf16, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zzzz(s, gen_helper_gvec_bfdot, a, 0);
-}
+TRANS_FEAT(BFDOT_zzzz, aa64_sve_bf16, gen_gvec_ool_arg_zzzz,
+           gen_helper_gvec_bfdot, a, 0)
 
 static bool trans_BFDOT_zzxz(DisasContext *s, arg_rrxr_esz *a)
 {
@@ -XXX,XX +XXX,XX @@ static bool trans_BFDOT_zzxz(DisasContext *s, arg_rrxr_esz *a)
                              a->rd, a->rn, a->rm, a->ra, a->index);
 }
 
-static bool trans_BFMMLA(DisasContext *s, arg_rrrr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve_bf16, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zzzz(s, gen_helper_gvec_bfmmla, a, 0);
-}
+TRANS_FEAT(BFMMLA, aa64_sve_bf16, gen_gvec_ool_arg_zzzz,
+           gen_helper_gvec_bfmmla, a, 0)
 
 static bool do_BFMLAL_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sel)
 {
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Rename the function to match gen_gvec_ool_arg_zzzz,
and move to be adjacent.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-14-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 18 +++++++++---------
 1 file changed, 9 insertions(+), 9 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions directly using
gen_gvec_ool_arg_zzxz to TRANS_FEAT.  Also include
BFDOT_zzxz, which was using gen_gvec_ool_zzzz.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-15-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 48 +++++++++++---------------------------
 1 file changed, 14 insertions(+), 34 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(DOT_zzzz, aa64_sve, gen_gvec_ool_zzzz,
  * SVE Multiply - Indexed
  */
 
-#define DO_RRXR(NAME, FUNC) \
-    static bool NAME(DisasContext *s, arg_rrxr_esz *a)  \
-    { return gen_gvec_ool_arg_zzxz(s, FUNC, a); }
+TRANS_FEAT(SDOT_zzxw_s, aa64_sve, gen_gvec_ool_arg_zzxz,
+           gen_helper_gvec_sdot_idx_b, a)
+TRANS_FEAT(SDOT_zzxw_d, aa64_sve, gen_gvec_ool_arg_zzxz,
+           gen_helper_gvec_sdot_idx_h, a)
+TRANS_FEAT(UDOT_zzxw_s, aa64_sve, gen_gvec_ool_arg_zzxz,
+           gen_helper_gvec_udot_idx_b, a)
+TRANS_FEAT(UDOT_zzxw_d, aa64_sve, gen_gvec_ool_arg_zzxz,
+           gen_helper_gvec_udot_idx_h, a)
 
-DO_RRXR(trans_SDOT_zzxw_s, gen_helper_gvec_sdot_idx_b)
-DO_RRXR(trans_SDOT_zzxw_d, gen_helper_gvec_sdot_idx_h)
-DO_RRXR(trans_UDOT_zzxw_s, gen_helper_gvec_udot_idx_b)
-DO_RRXR(trans_UDOT_zzxw_d, gen_helper_gvec_udot_idx_h)
-
-static bool trans_SUDOT_zzxw_s(DisasContext *s, arg_rrxr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve_i8mm, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zzxz(s, gen_helper_gvec_sudot_idx_b, a);
-}
-
-static bool trans_USDOT_zzxw_s(DisasContext *s, arg_rrxr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve_i8mm, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zzxz(s, gen_helper_gvec_usdot_idx_b, a);
-}
-
-#undef DO_RRXR
+TRANS_FEAT(SUDOT_zzxw_s, aa64_sve_i8mm, gen_gvec_ool_arg_zzxz,
+           gen_helper_gvec_sudot_idx_b, a)
+TRANS_FEAT(USDOT_zzxw_s, aa64_sve_i8mm, gen_gvec_ool_arg_zzxz,
+           gen_helper_gvec_usdot_idx_b, a)
 
 static bool do_sve2_zzz_data(DisasContext *s, int rd, int rn, int rm, int data,
                              gen_helper_gvec_3 *fn)
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(UMMLA, aa64_sve_i8mm, gen_gvec_ool_arg_zzzz,
 
 TRANS_FEAT(BFDOT_zzzz, aa64_sve_bf16, gen_gvec_ool_arg_zzzz,
            gen_helper_gvec_bfdot, a, 0)
-
-static bool trans_BFDOT_zzxz(DisasContext *s, arg_rrxr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve_bf16, s)) {
-        return false;
-    }
-    return gen_gvec_ool_zzzz(s, gen_helper_gvec_bfdot_idx,
-                             a->rd, a->rn, a->rm, a->ra, a->index);
-}
+TRANS_FEAT(BFDOT_zzxz, aa64_sve_bf16, gen_gvec_ool_arg_zzxz,
+           gen_helper_gvec_bfdot_idx, a)
 
 TRANS_FEAT(BFMMLA, aa64_sve_bf16, gen_gvec_ool_arg_zzzz,
            gen_helper_gvec_bfmmla, a, 0)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions using do_sve2_zzz_data
to use TRANS_FEAT and gen_gvec_ool_zzz.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-16-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 69 ++++++++++++++------------------------
 1 file changed, 25 insertions(+), 44 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(SUDOT_zzxw_s, aa64_sve_i8mm, gen_gvec_ool_arg_zzxz,
 TRANS_FEAT(USDOT_zzxw_s, aa64_sve_i8mm, gen_gvec_ool_arg_zzxz,
            gen_helper_gvec_usdot_idx_b, a)
 
-static bool do_sve2_zzz_data(DisasContext *s, int rd, int rn, int rm, int data,
-                             gen_helper_gvec_3 *fn)
-{
-    if (fn == NULL || !dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    if (sve_access_check(s)) {
-        unsigned vsz = vec_full_reg_size(s);
-        tcg_gen_gvec_3_ool(vec_full_reg_offset(s, rd),
-                           vec_full_reg_offset(s, rn),
-                           vec_full_reg_offset(s, rm),
-                           vsz, vsz, data, fn);
-    }
-    return true;
-}
-
 #define DO_SVE2_RRX(NAME, FUNC) \
-    static bool NAME(DisasContext *s, arg_rrx_esz *a)  \
-    { return do_sve2_zzz_data(s, a->rd, a->rn, a->rm, a->index, FUNC); }
+    TRANS_FEAT(NAME, aa64_sve, gen_gvec_ool_zzz, FUNC,          \
+               a->rd, a->rn, a->rm, a->index)
 
-DO_SVE2_RRX(trans_MUL_zzx_h, gen_helper_gvec_mul_idx_h)
-DO_SVE2_RRX(trans_MUL_zzx_s, gen_helper_gvec_mul_idx_s)
-DO_SVE2_RRX(trans_MUL_zzx_d, gen_helper_gvec_mul_idx_d)
+DO_SVE2_RRX(MUL_zzx_h, gen_helper_gvec_mul_idx_h)
+DO_SVE2_RRX(MUL_zzx_s, gen_helper_gvec_mul_idx_s)
+DO_SVE2_RRX(MUL_zzx_d, gen_helper_gvec_mul_idx_d)
 
-DO_SVE2_RRX(trans_SQDMULH_zzx_h, gen_helper_sve2_sqdmulh_idx_h)
-DO_SVE2_RRX(trans_SQDMULH_zzx_s, gen_helper_sve2_sqdmulh_idx_s)
-DO_SVE2_RRX(trans_SQDMULH_zzx_d, gen_helper_sve2_sqdmulh_idx_d)
+DO_SVE2_RRX(SQDMULH_zzx_h, gen_helper_sve2_sqdmulh_idx_h)
+DO_SVE2_RRX(SQDMULH_zzx_s, gen_helper_sve2_sqdmulh_idx_s)
+DO_SVE2_RRX(SQDMULH_zzx_d, gen_helper_sve2_sqdmulh_idx_d)
 
-DO_SVE2_RRX(trans_SQRDMULH_zzx_h, gen_helper_sve2_sqrdmulh_idx_h)
-DO_SVE2_RRX(trans_SQRDMULH_zzx_s, gen_helper_sve2_sqrdmulh_idx_s)
-DO_SVE2_RRX(trans_SQRDMULH_zzx_d, gen_helper_sve2_sqrdmulh_idx_d)
+DO_SVE2_RRX(SQRDMULH_zzx_h, gen_helper_sve2_sqrdmulh_idx_h)
+DO_SVE2_RRX(SQRDMULH_zzx_s, gen_helper_sve2_sqrdmulh_idx_s)
+DO_SVE2_RRX(SQRDMULH_zzx_d, gen_helper_sve2_sqrdmulh_idx_d)
 
 #undef DO_SVE2_RRX
 
 #define DO_SVE2_RRX_TB(NAME, FUNC, TOP) \
-    static bool NAME(DisasContext *s, arg_rrx_esz *a)           \
-    {                                                           \
-        return do_sve2_zzz_data(s, a->rd, a->rn, a->rm,         \
-                                (a->index << 1) | TOP, FUNC);   \
-    }
+    TRANS_FEAT(NAME, aa64_sve, gen_gvec_ool_zzz, FUNC,          \
+               a->rd, a->rn, a->rm, (a->index << 1) | TOP)
 
-DO_SVE2_RRX_TB(trans_SQDMULLB_zzx_s, gen_helper_sve2_sqdmull_idx_s, false)
-DO_SVE2_RRX_TB(trans_SQDMULLB_zzx_d, gen_helper_sve2_sqdmull_idx_d, false)
-DO_SVE2_RRX_TB(trans_SQDMULLT_zzx_s, gen_helper_sve2_sqdmull_idx_s, true)
-DO_SVE2_RRX_TB(trans_SQDMULLT_zzx_d, gen_helper_sve2_sqdmull_idx_d, true)
+DO_SVE2_RRX_TB(SQDMULLB_zzx_s, gen_helper_sve2_sqdmull_idx_s, false)
+DO_SVE2_RRX_TB(SQDMULLB_zzx_d, gen_helper_sve2_sqdmull_idx_d, false)
+DO_SVE2_RRX_TB(SQDMULLT_zzx_s, gen_helper_sve2_sqdmull_idx_s, true)
+DO_SVE2_RRX_TB(SQDMULLT_zzx_d, gen_helper_sve2_sqdmull_idx_d, true)
 
-DO_SVE2_RRX_TB(trans_SMULLB_zzx_s, gen_helper_sve2_smull_idx_s, false)
-DO_SVE2_RRX_TB(trans_SMULLB_zzx_d, gen_helper_sve2_smull_idx_d, false)
-DO_SVE2_RRX_TB(trans_SMULLT_zzx_s, gen_helper_sve2_smull_idx_s, true)
-DO_SVE2_RRX_TB(trans_SMULLT_zzx_d, gen_helper_sve2_smull_idx_d, true)
+DO_SVE2_RRX_TB(SMULLB_zzx_s, gen_helper_sve2_smull_idx_s, false)
+DO_SVE2_RRX_TB(SMULLB_zzx_d, gen_helper_sve2_smull_idx_d, false)
+DO_SVE2_RRX_TB(SMULLT_zzx_s, gen_helper_sve2_smull_idx_s, true)
+DO_SVE2_RRX_TB(SMULLT_zzx_d, gen_helper_sve2_smull_idx_d, true)
 
-DO_SVE2_RRX_TB(trans_UMULLB_zzx_s, gen_helper_sve2_umull_idx_s, false)
-DO_SVE2_RRX_TB(trans_UMULLB_zzx_d, gen_helper_sve2_umull_idx_d, false)
-DO_SVE2_RRX_TB(trans_UMULLT_zzx_s, gen_helper_sve2_umull_idx_s, true)
-DO_SVE2_RRX_TB(trans_UMULLT_zzx_d, gen_helper_sve2_umull_idx_d, true)
+DO_SVE2_RRX_TB(UMULLB_zzx_s, gen_helper_sve2_umull_idx_s, false)
+DO_SVE2_RRX_TB(UMULLB_zzx_d, gen_helper_sve2_umull_idx_d, false)
+DO_SVE2_RRX_TB(UMULLT_zzx_s, gen_helper_sve2_umull_idx_s, true)
+DO_SVE2_RRX_TB(UMULLT_zzx_d, gen_helper_sve2_umull_idx_d, true)
 
 #undef DO_SVE2_RRX_TB
 
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions using do_sve2_zzzz_data
to use TRANS_FEAT and gen_gvec_ool_{zzzz,zzxz}.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-17-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 106 ++++++++++++++-----------------------
 1 file changed, 41 insertions(+), 65 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ DO_SVE2_RRX_TB(UMULLT_zzx_d, gen_helper_sve2_umull_idx_d, true)
 
 #undef DO_SVE2_RRX_TB
 
-static bool do_sve2_zzzz_data(DisasContext *s, int rd, int rn, int rm, int ra,
-                              int data, gen_helper_gvec_4 *fn)
-{
-    if (fn == NULL || !dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    if (sve_access_check(s)) {
-        unsigned vsz = vec_full_reg_size(s);
-        tcg_gen_gvec_4_ool(vec_full_reg_offset(s, rd),
-                           vec_full_reg_offset(s, rn),
-                           vec_full_reg_offset(s, rm),
-                           vec_full_reg_offset(s, ra),
-                           vsz, vsz, data, fn);
-    }
-    return true;
-}
-
 #define DO_SVE2_RRXR(NAME, FUNC) \
-    static bool NAME(DisasContext *s, arg_rrxr_esz *a)  \
-    { return do_sve2_zzzz_data(s, a->rd, a->rn, a->rm, a->ra, a->index, FUNC); }
+    TRANS_FEAT(NAME, aa64_sve2, gen_gvec_ool_arg_zzxz, FUNC, a)
 
-DO_SVE2_RRXR(trans_MLA_zzxz_h, gen_helper_gvec_mla_idx_h)
-DO_SVE2_RRXR(trans_MLA_zzxz_s, gen_helper_gvec_mla_idx_s)
-DO_SVE2_RRXR(trans_MLA_zzxz_d, gen_helper_gvec_mla_idx_d)
+DO_SVE2_RRXR(MLA_zzxz_h, gen_helper_gvec_mla_idx_h)
+DO_SVE2_RRXR(MLA_zzxz_s, gen_helper_gvec_mla_idx_s)
+DO_SVE2_RRXR(MLA_zzxz_d, gen_helper_gvec_mla_idx_d)
 
-DO_SVE2_RRXR(trans_MLS_zzxz_h, gen_helper_gvec_mls_idx_h)
-DO_SVE2_RRXR(trans_MLS_zzxz_s, gen_helper_gvec_mls_idx_s)
-DO_SVE2_RRXR(trans_MLS_zzxz_d, gen_helper_gvec_mls_idx_d)
+DO_SVE2_RRXR(MLS_zzxz_h, gen_helper_gvec_mls_idx_h)
+DO_SVE2_RRXR(MLS_zzxz_s, gen_helper_gvec_mls_idx_s)
+DO_SVE2_RRXR(MLS_zzxz_d, gen_helper_gvec_mls_idx_d)
 
-DO_SVE2_RRXR(trans_SQRDMLAH_zzxz_h, gen_helper_sve2_sqrdmlah_idx_h)
-DO_SVE2_RRXR(trans_SQRDMLAH_zzxz_s, gen_helper_sve2_sqrdmlah_idx_s)
-DO_SVE2_RRXR(trans_SQRDMLAH_zzxz_d, gen_helper_sve2_sqrdmlah_idx_d)
+DO_SVE2_RRXR(SQRDMLAH_zzxz_h, gen_helper_sve2_sqrdmlah_idx_h)
+DO_SVE2_RRXR(SQRDMLAH_zzxz_s, gen_helper_sve2_sqrdmlah_idx_s)
+DO_SVE2_RRXR(SQRDMLAH_zzxz_d, gen_helper_sve2_sqrdmlah_idx_d)
 
-DO_SVE2_RRXR(trans_SQRDMLSH_zzxz_h, gen_helper_sve2_sqrdmlsh_idx_h)
-DO_SVE2_RRXR(trans_SQRDMLSH_zzxz_s, gen_helper_sve2_sqrdmlsh_idx_s)
-DO_SVE2_RRXR(trans_SQRDMLSH_zzxz_d, gen_helper_sve2_sqrdmlsh_idx_d)
+DO_SVE2_RRXR(SQRDMLSH_zzxz_h, gen_helper_sve2_sqrdmlsh_idx_h)
+DO_SVE2_RRXR(SQRDMLSH_zzxz_s, gen_helper_sve2_sqrdmlsh_idx_s)
+DO_SVE2_RRXR(SQRDMLSH_zzxz_d, gen_helper_sve2_sqrdmlsh_idx_d)
 
 #undef DO_SVE2_RRXR
 
 #define DO_SVE2_RRXR_TB(NAME, FUNC, TOP) \
-    static bool NAME(DisasContext *s, arg_rrxr_esz *a)          \
-    {                                                           \
-        return do_sve2_zzzz_data(s, a->rd, a->rn, a->rm, a->rd, \
-                                 (a->index << 1) | TOP, FUNC);  \
-    }
+    TRANS_FEAT(NAME, aa64_sve2, gen_gvec_ool_zzzz, FUNC,        \
+               a->rd, a->rn, a->rm, a->ra, (a->index << 1) | TOP)
 
-DO_SVE2_RRXR_TB(trans_SQDMLALB_zzxw_s, gen_helper_sve2_sqdmlal_idx_s, false)
-DO_SVE2_RRXR_TB(trans_SQDMLALB_zzxw_d, gen_helper_sve2_sqdmlal_idx_d, false)
-DO_SVE2_RRXR_TB(trans_SQDMLALT_zzxw_s, gen_helper_sve2_sqdmlal_idx_s, true)
-DO_SVE2_RRXR_TB(trans_SQDMLALT_zzxw_d, gen_helper_sve2_sqdmlal_idx_d, true)
+DO_SVE2_RRXR_TB(SQDMLALB_zzxw_s, gen_helper_sve2_sqdmlal_idx_s, false)
+DO_SVE2_RRXR_TB(SQDMLALB_zzxw_d, gen_helper_sve2_sqdmlal_idx_d, false)
+DO_SVE2_RRXR_TB(SQDMLALT_zzxw_s, gen_helper_sve2_sqdmlal_idx_s, true)
+DO_SVE2_RRXR_TB(SQDMLALT_zzxw_d, gen_helper_sve2_sqdmlal_idx_d, true)
 
-DO_SVE2_RRXR_TB(trans_SQDMLSLB_zzxw_s, gen_helper_sve2_sqdmlsl_idx_s, false)
-DO_SVE2_RRXR_TB(trans_SQDMLSLB_zzxw_d, gen_helper_sve2_sqdmlsl_idx_d, false)
-DO_SVE2_RRXR_TB(trans_SQDMLSLT_zzxw_s, gen_helper_sve2_sqdmlsl_idx_s, true)
-DO_SVE2_RRXR_TB(trans_SQDMLSLT_zzxw_d, gen_helper_sve2_sqdmlsl_idx_d, true)
+DO_SVE2_RRXR_TB(SQDMLSLB_zzxw_s, gen_helper_sve2_sqdmlsl_idx_s, false)
+DO_SVE2_RRXR_TB(SQDMLSLB_zzxw_d, gen_helper_sve2_sqdmlsl_idx_d, false)
+DO_SVE2_RRXR_TB(SQDMLSLT_zzxw_s, gen_helper_sve2_sqdmlsl_idx_s, true)
+DO_SVE2_RRXR_TB(SQDMLSLT_zzxw_d, gen_helper_sve2_sqdmlsl_idx_d, true)
 
-DO_SVE2_RRXR_TB(trans_SMLALB_zzxw_s, gen_helper_sve2_smlal_idx_s, false)
-DO_SVE2_RRXR_TB(trans_SMLALB_zzxw_d, gen_helper_sve2_smlal_idx_d, false)
-DO_SVE2_RRXR_TB(trans_SMLALT_zzxw_s, gen_helper_sve2_smlal_idx_s, true)
-DO_SVE2_RRXR_TB(trans_SMLALT_zzxw_d, gen_helper_sve2_smlal_idx_d, true)
+DO_SVE2_RRXR_TB(SMLALB_zzxw_s, gen_helper_sve2_smlal_idx_s, false)
+DO_SVE2_RRXR_TB(SMLALB_zzxw_d, gen_helper_sve2_smlal_idx_d, false)
+DO_SVE2_RRXR_TB(SMLALT_zzxw_s, gen_helper_sve2_smlal_idx_s, true)
+DO_SVE2_RRXR_TB(SMLALT_zzxw_d, gen_helper_sve2_smlal_idx_d, true)
 
-DO_SVE2_RRXR_TB(trans_UMLALB_zzxw_s, gen_helper_sve2_umlal_idx_s, false)
-DO_SVE2_RRXR_TB(trans_UMLALB_zzxw_d, gen_helper_sve2_umlal_idx_d, false)
-DO_SVE2_RRXR_TB(trans_UMLALT_zzxw_s, gen_helper_sve2_umlal_idx_s, true)
-DO_SVE2_RRXR_TB(trans_UMLALT_zzxw_d, gen_helper_sve2_umlal_idx_d, true)
+DO_SVE2_RRXR_TB(UMLALB_zzxw_s, gen_helper_sve2_umlal_idx_s, false)
+DO_SVE2_RRXR_TB(UMLALB_zzxw_d, gen_helper_sve2_umlal_idx_d, false)
+DO_SVE2_RRXR_TB(UMLALT_zzxw_s, gen_helper_sve2_umlal_idx_s, true)
+DO_SVE2_RRXR_TB(UMLALT_zzxw_d, gen_helper_sve2_umlal_idx_d, true)
 
-DO_SVE2_RRXR_TB(trans_SMLSLB_zzxw_s, gen_helper_sve2_smlsl_idx_s, false)
-DO_SVE2_RRXR_TB(trans_SMLSLB_zzxw_d, gen_helper_sve2_smlsl_idx_d, false)
-DO_SVE2_RRXR_TB(trans_SMLSLT_zzxw_s, gen_helper_sve2_smlsl_idx_s, true)
-DO_SVE2_RRXR_TB(trans_SMLSLT_zzxw_d, gen_helper_sve2_smlsl_idx_d, true)
+DO_SVE2_RRXR_TB(SMLSLB_zzxw_s, gen_helper_sve2_smlsl_idx_s, false)
+DO_SVE2_RRXR_TB(SMLSLB_zzxw_d, gen_helper_sve2_smlsl_idx_d, false)
+DO_SVE2_RRXR_TB(SMLSLT_zzxw_s, gen_helper_sve2_smlsl_idx_s, true)
+DO_SVE2_RRXR_TB(SMLSLT_zzxw_d, gen_helper_sve2_smlsl_idx_d, true)
 
-DO_SVE2_RRXR_TB(trans_UMLSLB_zzxw_s, gen_helper_sve2_umlsl_idx_s, false)
-DO_SVE2_RRXR_TB(trans_UMLSLB_zzxw_d, gen_helper_sve2_umlsl_idx_d, false)
-DO_SVE2_RRXR_TB(trans_UMLSLT_zzxw_s, gen_helper_sve2_umlsl_idx_s, true)
-DO_SVE2_RRXR_TB(trans_UMLSLT_zzxw_d, gen_helper_sve2_umlsl_idx_d, true)
+DO_SVE2_RRXR_TB(UMLSLB_zzxw_s, gen_helper_sve2_umlsl_idx_s, false)
+DO_SVE2_RRXR_TB(UMLSLB_zzxw_d, gen_helper_sve2_umlsl_idx_d, false)
+DO_SVE2_RRXR_TB(UMLSLT_zzxw_s, gen_helper_sve2_umlsl_idx_s, true)
+DO_SVE2_RRXR_TB(UMLSLT_zzxw_d, gen_helper_sve2_umlsl_idx_d, true)
 
 #undef DO_SVE2_RRXR_TB
 
 #define DO_SVE2_RRXR_ROT(NAME, FUNC) \
-    static bool trans_##NAME(DisasContext *s, arg_##NAME *a)       \
-    {                                                              \
-        return do_sve2_zzzz_data(s, a->rd, a->rn, a->rm, a->ra,    \
-                                 (a->index << 2) | a->rot, FUNC);  \
-    }
+    TRANS_FEAT(NAME, aa64_sve2, gen_gvec_ool_zzzz, FUNC,           \
+               a->rd, a->rn, a->rm, a->ra, (a->index << 2) | a->rot)
 
 DO_SVE2_RRXR_ROT(CMLA_zzxz_h, gen_helper_sve2_cmla_idx_h)
 DO_SVE2_RRXR_ROT(CMLA_zzxz_s, gen_helper_sve2_cmla_idx_s)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions using do_sve2_zzw_data
to use TRANS_FEAT and gen_gvec_ool_arg_zzz.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-18-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 297 ++++++++++++++++++-------------------
 1 file changed, 145 insertions(+), 152 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ DO_SVE2_ZPZZ(USQADD, usqadd)
  * SVE2 Widening Integer Arithmetic
  */
 
-static bool do_sve2_zzw_ool(DisasContext *s, arg_rrr_esz *a,
-                            gen_helper_gvec_3 *fn, int data)
-{
-    if (fn == NULL || !dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    if (sve_access_check(s)) {
-        unsigned vsz = vec_full_reg_size(s);
-        tcg_gen_gvec_3_ool(vec_full_reg_offset(s, a->rd),
-                           vec_full_reg_offset(s, a->rn),
-                           vec_full_reg_offset(s, a->rm),
-                           vsz, vsz, data, fn);
-    }
-    return true;
-}
+static gen_helper_gvec_3 * const saddl_fns[4] = {
+    NULL,                    gen_helper_sve2_saddl_h,
+    gen_helper_sve2_saddl_s, gen_helper_sve2_saddl_d,
+};
+TRANS_FEAT(SADDLB, aa64_sve2, gen_gvec_ool_arg_zzz,
+           saddl_fns[a->esz], a, 0)
+TRANS_FEAT(SADDLT, aa64_sve2, gen_gvec_ool_arg_zzz,
+           saddl_fns[a->esz], a, 3)
+TRANS_FEAT(SADDLBT, aa64_sve2, gen_gvec_ool_arg_zzz,
+           saddl_fns[a->esz], a, 2)
 
-#define DO_SVE2_ZZZ_TB(NAME, name, SEL1, SEL2) \
-static bool trans_##NAME(DisasContext *s, arg_rrr_esz *a)               \
-{                                                                       \
-    static gen_helper_gvec_3 * const fns[4] = {                         \
-        NULL,                       gen_helper_sve2_##name##_h,         \
-        gen_helper_sve2_##name##_s, gen_helper_sve2_##name##_d,         \
-    };                                                                  \
-    return do_sve2_zzw_ool(s, a, fns[a->esz], (SEL2 << 1) | SEL1);      \
-}
+static gen_helper_gvec_3 * const ssubl_fns[4] = {
+    NULL,                    gen_helper_sve2_ssubl_h,
+    gen_helper_sve2_ssubl_s, gen_helper_sve2_ssubl_d,
+};
+TRANS_FEAT(SSUBLB, aa64_sve2, gen_gvec_ool_arg_zzz,
+           ssubl_fns[a->esz], a, 0)
+TRANS_FEAT(SSUBLT, aa64_sve2, gen_gvec_ool_arg_zzz,
+           ssubl_fns[a->esz], a, 3)
+TRANS_FEAT(SSUBLBT, aa64_sve2, gen_gvec_ool_arg_zzz,
+           ssubl_fns[a->esz], a, 2)
+TRANS_FEAT(SSUBLTB, aa64_sve2, gen_gvec_ool_arg_zzz,
+           ssubl_fns[a->esz], a, 1)
 
-DO_SVE2_ZZZ_TB(SADDLB, saddl, false, false)
-DO_SVE2_ZZZ_TB(SSUBLB, ssubl, false, false)
-DO_SVE2_ZZZ_TB(SABDLB, sabdl, false, false)
+static gen_helper_gvec_3 * const sabdl_fns[4] = {
+    NULL,                    gen_helper_sve2_sabdl_h,
+    gen_helper_sve2_sabdl_s, gen_helper_sve2_sabdl_d,
+};
+TRANS_FEAT(SABDLB, aa64_sve2, gen_gvec_ool_arg_zzz,
+           sabdl_fns[a->esz], a, 0)
+TRANS_FEAT(SABDLT, aa64_sve2, gen_gvec_ool_arg_zzz,
+           sabdl_fns[a->esz], a, 3)
 
-DO_SVE2_ZZZ_TB(UADDLB, uaddl, false, false)
-DO_SVE2_ZZZ_TB(USUBLB, usubl, false, false)
-DO_SVE2_ZZZ_TB(UABDLB, uabdl, false, false)
+static gen_helper_gvec_3 * const uaddl_fns[4] = {
+    NULL,                    gen_helper_sve2_uaddl_h,
+    gen_helper_sve2_uaddl_s, gen_helper_sve2_uaddl_d,
+};
+TRANS_FEAT(UADDLB, aa64_sve2, gen_gvec_ool_arg_zzz,
+           uaddl_fns[a->esz], a, 0)
+TRANS_FEAT(UADDLT, aa64_sve2, gen_gvec_ool_arg_zzz,
+           uaddl_fns[a->esz], a, 3)
 
-DO_SVE2_ZZZ_TB(SADDLT, saddl, true, true)
-DO_SVE2_ZZZ_TB(SSUBLT, ssubl, true, true)
-DO_SVE2_ZZZ_TB(SABDLT, sabdl, true, true)
+static gen_helper_gvec_3 * const usubl_fns[4] = {
+    NULL,                    gen_helper_sve2_usubl_h,
+    gen_helper_sve2_usubl_s, gen_helper_sve2_usubl_d,
+};
+TRANS_FEAT(USUBLB, aa64_sve2, gen_gvec_ool_arg_zzz,
+           usubl_fns[a->esz], a, 0)
+TRANS_FEAT(USUBLT, aa64_sve2, gen_gvec_ool_arg_zzz,
+           usubl_fns[a->esz], a, 3)
 
-DO_SVE2_ZZZ_TB(UADDLT, uaddl, true, true)
-DO_SVE2_ZZZ_TB(USUBLT, usubl, true, true)
-DO_SVE2_ZZZ_TB(UABDLT, uabdl, true, true)
+static gen_helper_gvec_3 * const uabdl_fns[4] = {
+    NULL,                    gen_helper_sve2_uabdl_h,
+    gen_helper_sve2_uabdl_s, gen_helper_sve2_uabdl_d,
+};
+TRANS_FEAT(UABDLB, aa64_sve2, gen_gvec_ool_arg_zzz,
+           uabdl_fns[a->esz], a, 0)
+TRANS_FEAT(UABDLT, aa64_sve2, gen_gvec_ool_arg_zzz,
+           uabdl_fns[a->esz], a, 3)
 
-DO_SVE2_ZZZ_TB(SADDLBT, saddl, false, true)
-DO_SVE2_ZZZ_TB(SSUBLBT, ssubl, false, true)
-DO_SVE2_ZZZ_TB(SSUBLTB, ssubl, true, false)
+static gen_helper_gvec_3 * const sqdmull_fns[4] = {
+    NULL,                          gen_helper_sve2_sqdmull_zzz_h,
+    gen_helper_sve2_sqdmull_zzz_s, gen_helper_sve2_sqdmull_zzz_d,
+};
+TRANS_FEAT(SQDMULLB_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
+           sqdmull_fns[a->esz], a, 0)
+TRANS_FEAT(SQDMULLT_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
+           sqdmull_fns[a->esz], a, 3)
 
-DO_SVE2_ZZZ_TB(SQDMULLB_zzz, sqdmull_zzz, false, false)
-DO_SVE2_ZZZ_TB(SQDMULLT_zzz, sqdmull_zzz, true, true)
+static gen_helper_gvec_3 * const smull_fns[4] = {
+    NULL,                        gen_helper_sve2_smull_zzz_h,
+    gen_helper_sve2_smull_zzz_s, gen_helper_sve2_smull_zzz_d,
+};
+TRANS_FEAT(SMULLB_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
+           smull_fns[a->esz], a, 0)
+TRANS_FEAT(SMULLT_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
+           smull_fns[a->esz], a, 3)
 
-DO_SVE2_ZZZ_TB(SMULLB_zzz, smull_zzz, false, false)
-DO_SVE2_ZZZ_TB(SMULLT_zzz, smull_zzz, true, true)
+static gen_helper_gvec_3 * const umull_fns[4] = {
+    NULL,                        gen_helper_sve2_umull_zzz_h,
+    gen_helper_sve2_umull_zzz_s, gen_helper_sve2_umull_zzz_d,
+};
+TRANS_FEAT(UMULLB_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
+           umull_fns[a->esz], a, 0)
+TRANS_FEAT(UMULLT_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
+           umull_fns[a->esz], a, 3)
 
-DO_SVE2_ZZZ_TB(UMULLB_zzz, umull_zzz, false, false)
-DO_SVE2_ZZZ_TB(UMULLT_zzz, umull_zzz, true, true)
-
-static bool do_eor_tb(DisasContext *s, arg_rrr_esz *a, bool sel1)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_sve2_eoril_b, gen_helper_sve2_eoril_h,
-        gen_helper_sve2_eoril_s, gen_helper_sve2_eoril_d,
-    };
-    return do_sve2_zzw_ool(s, a, fns[a->esz], (!sel1 << 1) | sel1);
-}
-
-static bool trans_EORBT(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_eor_tb(s, a, false);
-}
-
-static bool trans_EORTB(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_eor_tb(s, a, true);
-}
+static gen_helper_gvec_3 * const eoril_fns[4] = {
+    gen_helper_sve2_eoril_b, gen_helper_sve2_eoril_h,
+    gen_helper_sve2_eoril_s, gen_helper_sve2_eoril_d,
+};
+TRANS_FEAT(EORBT, aa64_sve2, gen_gvec_ool_arg_zzz, eoril_fns[a->esz], a, 2)
+TRANS_FEAT(EORTB, aa64_sve2, gen_gvec_ool_arg_zzz, eoril_fns[a->esz], a, 1)
 
 static bool do_trans_pmull(DisasContext *s, arg_rrr_esz *a, bool sel)
 {
@@ -XXX,XX +XXX,XX @@ static bool do_trans_pmull(DisasContext *s, arg_rrr_esz *a, bool sel)
     if (a->esz == 0 && !dc_isar_feature(aa64_sve2_pmull128, s)) {
         return false;
     }
-    return do_sve2_zzw_ool(s, a, fns[a->esz], sel);
+    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, sel);
 }
 
-static bool trans_PMULLB(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_trans_pmull(s, a, false);
-}
+TRANS_FEAT(PMULLB, aa64_sve2, do_trans_pmull, a, false)
+TRANS_FEAT(PMULLT, aa64_sve2, do_trans_pmull, a, true)
 
-static bool trans_PMULLT(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_trans_pmull(s, a, true);
-}
+static gen_helper_gvec_3 * const saddw_fns[4] = {
+    NULL,                    gen_helper_sve2_saddw_h,
+    gen_helper_sve2_saddw_s, gen_helper_sve2_saddw_d,
+};
+TRANS_FEAT(SADDWB, aa64_sve2, gen_gvec_ool_arg_zzz, saddw_fns[a->esz], a, 0)
+TRANS_FEAT(SADDWT, aa64_sve2, gen_gvec_ool_arg_zzz, saddw_fns[a->esz], a, 1)
 
-#define DO_SVE2_ZZZ_WTB(NAME, name, SEL2) \
-static bool trans_##NAME(DisasContext *s, arg_rrr_esz *a)       \
-{                                                               \
-    static gen_helper_gvec_3 * const fns[4] = {                 \
-        NULL,                       gen_helper_sve2_##name##_h, \
-        gen_helper_sve2_##name##_s, gen_helper_sve2_##name##_d, \
-    };                                                          \
-    return do_sve2_zzw_ool(s, a, fns[a->esz], SEL2);            \
-}
+static gen_helper_gvec_3 * const ssubw_fns[4] = {
+    NULL,                    gen_helper_sve2_ssubw_h,
+    gen_helper_sve2_ssubw_s, gen_helper_sve2_ssubw_d,
+};
+TRANS_FEAT(SSUBWB, aa64_sve2, gen_gvec_ool_arg_zzz, ssubw_fns[a->esz], a, 0)
+TRANS_FEAT(SSUBWT, aa64_sve2, gen_gvec_ool_arg_zzz, ssubw_fns[a->esz], a, 1)
 
-DO_SVE2_ZZZ_WTB(SADDWB, saddw, false)
-DO_SVE2_ZZZ_WTB(SADDWT, saddw, true)
-DO_SVE2_ZZZ_WTB(SSUBWB, ssubw, false)
-DO_SVE2_ZZZ_WTB(SSUBWT, ssubw, true)
+static gen_helper_gvec_3 * const uaddw_fns[4] = {
+    NULL,                    gen_helper_sve2_uaddw_h,
+    gen_helper_sve2_uaddw_s, gen_helper_sve2_uaddw_d,
+};
+TRANS_FEAT(UADDWB, aa64_sve2, gen_gvec_ool_arg_zzz, uaddw_fns[a->esz], a, 0)
+TRANS_FEAT(UADDWT, aa64_sve2, gen_gvec_ool_arg_zzz, uaddw_fns[a->esz], a, 1)
 
-DO_SVE2_ZZZ_WTB(UADDWB, uaddw, false)
-DO_SVE2_ZZZ_WTB(UADDWT, uaddw, true)
-DO_SVE2_ZZZ_WTB(USUBWB, usubw, false)
-DO_SVE2_ZZZ_WTB(USUBWT, usubw, true)
+static gen_helper_gvec_3 * const usubw_fns[4] = {
+    NULL,                    gen_helper_sve2_usubw_h,
+    gen_helper_sve2_usubw_s, gen_helper_sve2_usubw_d,
+};
+TRANS_FEAT(USUBWB, aa64_sve2, gen_gvec_ool_arg_zzz, usubw_fns[a->esz], a, 0)
+TRANS_FEAT(USUBWT, aa64_sve2, gen_gvec_ool_arg_zzz, usubw_fns[a->esz], a, 1)
 
 static void gen_sshll_vec(unsigned vece, TCGv_vec d, TCGv_vec n, int64_t imm)
 {
@@ -XXX,XX +XXX,XX @@ static bool trans_USHLLT(DisasContext *s, arg_rri_esz *a)
     return do_sve2_shll_tb(s, a, true, true);
 }
 
-static bool trans_BEXT(DisasContext *s, arg_rrr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_sve2_bext_b, gen_helper_sve2_bext_h,
-        gen_helper_sve2_bext_s, gen_helper_sve2_bext_d,
-    };
-    if (!dc_isar_feature(aa64_sve2_bitperm, s)) {
-        return false;
-    }
-    return do_sve2_zzw_ool(s, a, fns[a->esz], 0);
-}
+static gen_helper_gvec_3 * const bext_fns[4] = {
+    gen_helper_sve2_bext_b, gen_helper_sve2_bext_h,
+    gen_helper_sve2_bext_s, gen_helper_sve2_bext_d,
+};
+TRANS_FEAT(BEXT, aa64_sve2_bitperm, gen_gvec_ool_arg_zzz,
+           bext_fns[a->esz], a, 0)
 
-static bool trans_BDEP(DisasContext *s, arg_rrr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_sve2_bdep_b, gen_helper_sve2_bdep_h,
-        gen_helper_sve2_bdep_s, gen_helper_sve2_bdep_d,
-    };
-    if (!dc_isar_feature(aa64_sve2_bitperm, s)) {
-        return false;
-    }
-    return do_sve2_zzw_ool(s, a, fns[a->esz], 0);
-}
+static gen_helper_gvec_3 * const bdep_fns[4] = {
+    gen_helper_sve2_bdep_b, gen_helper_sve2_bdep_h,
+    gen_helper_sve2_bdep_s, gen_helper_sve2_bdep_d,
+};
+TRANS_FEAT(BDEP, aa64_sve2_bitperm, gen_gvec_ool_arg_zzz,
+           bdep_fns[a->esz], a, 0)
 
-static bool trans_BGRP(DisasContext *s, arg_rrr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_sve2_bgrp_b, gen_helper_sve2_bgrp_h,
-        gen_helper_sve2_bgrp_s, gen_helper_sve2_bgrp_d,
-    };
-    if (!dc_isar_feature(aa64_sve2_bitperm, s)) {
-        return false;
-    }
-    return do_sve2_zzw_ool(s, a, fns[a->esz], 0);
-}
+static gen_helper_gvec_3 * const bgrp_fns[4] = {
+    gen_helper_sve2_bgrp_b, gen_helper_sve2_bgrp_h,
+    gen_helper_sve2_bgrp_s, gen_helper_sve2_bgrp_d,
+};
+TRANS_FEAT(BGRP, aa64_sve2_bitperm, gen_gvec_ool_arg_zzz,
+           bgrp_fns[a->esz], a, 0)
 
-static bool do_cadd(DisasContext *s, arg_rrr_esz *a, bool sq, bool rot)
-{
-    static gen_helper_gvec_3 * const fns[2][4] = {
-        { gen_helper_sve2_cadd_b, gen_helper_sve2_cadd_h,
-          gen_helper_sve2_cadd_s, gen_helper_sve2_cadd_d },
-        { gen_helper_sve2_sqcadd_b, gen_helper_sve2_sqcadd_h,
-          gen_helper_sve2_sqcadd_s, gen_helper_sve2_sqcadd_d },
-    };
-    return do_sve2_zzw_ool(s, a, fns[sq][a->esz], rot);
-}
+static gen_helper_gvec_3 * const cadd_fns[4] = {
+    gen_helper_sve2_cadd_b, gen_helper_sve2_cadd_h,
+    gen_helper_sve2_cadd_s, gen_helper_sve2_cadd_d,
+};
+TRANS_FEAT(CADD_rot90, aa64_sve2, gen_gvec_ool_arg_zzz,
+           cadd_fns[a->esz], a, 0)
+TRANS_FEAT(CADD_rot270, aa64_sve2, gen_gvec_ool_arg_zzz,
+           cadd_fns[a->esz], a, 1)
 
-static bool trans_CADD_rot90(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_cadd(s, a, false, false);
-}
-
-static bool trans_CADD_rot270(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_cadd(s, a, false, true);
-}
-
-static bool trans_SQCADD_rot90(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_cadd(s, a, true, false);
-}
-
-static bool trans_SQCADD_rot270(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_cadd(s, a, true, true);
-}
+static gen_helper_gvec_3 * const sqcadd_fns[4] = {
+    gen_helper_sve2_sqcadd_b, gen_helper_sve2_sqcadd_h,
+    gen_helper_sve2_sqcadd_s, gen_helper_sve2_sqcadd_d,
+};
+TRANS_FEAT(SQCADD_rot90, aa64_sve2, gen_gvec_ool_arg_zzz,
+           sqcadd_fns[a->esz], a, 0)
+TRANS_FEAT(SQCADD_rot270, aa64_sve2, gen_gvec_ool_arg_zzz,
+           sqcadd_fns[a->esz], a, 1)
 
 static gen_helper_gvec_4 * const sabal_fns[4] = {
     NULL,                    gen_helper_sve2_sabal_h,
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

This is the last direct user of tcg_gen_gvec_4_ool.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-19-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 17 ++---------------
 1 file changed, 2 insertions(+), 15 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_4 * const sqrdcmlah_fns[] = {
 TRANS_FEAT(SQRDCMLAH_zzzz, aa64_sve2, gen_gvec_ool_zzzz,
            sqrdcmlah_fns[a->esz], a->rd, a->rn, a->rm, a->ra, a->rot)
 
-static bool trans_USDOT_zzzz(DisasContext *s, arg_USDOT_zzzz *a)
-{
-    if (a->esz != 2 || !dc_isar_feature(aa64_sve_i8mm, s)) {
-        return false;
-    }
-    if (sve_access_check(s)) {
-        unsigned vsz = vec_full_reg_size(s);
-        tcg_gen_gvec_4_ool(vec_full_reg_offset(s, a->rd),
-                           vec_full_reg_offset(s, a->rn),
-                           vec_full_reg_offset(s, a->rm),
-                           vec_full_reg_offset(s, a->ra),
-                           vsz, vsz, 0, gen_helper_gvec_usdot_b);
-    }
-    return true;
-}
+TRANS_FEAT(USDOT_zzzz, aa64_sve_i8mm, gen_gvec_ool_arg_zzzz,
+           a->esz == 2 ? gen_helper_gvec_usdot_b : NULL, a, 0)
 
 TRANS_FEAT(AESMC, aa64_sve2_aes, gen_gvec_ool_zz,
            gen_helper_crypto_aesmc, a->rd, a->rd, a->decrypt)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-20-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 37 +++++++++++++++----------------------
 1 file changed, 15 insertions(+), 22 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Use gen_gvec_ool_arg_zpz instead of gen_gvec_ool_zzp
when the arguments come from arg_rpr_esz.
Replaces do_zpz_ool.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-21-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 45 +++++++++++++++++++++-----------------
 1 file changed, 25 insertions(+), 20 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions directly using
gen_gvec_ool_arg_zpz to TRANS_FEAT.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-22-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 189 ++++++++++++-------------------------
 1 file changed, 60 insertions(+), 129 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_SEL_zpzz(DisasContext *s, arg_rprr_esz *a)
  *** SVE Integer Arithmetic - Unary Predicated Group
  */
 
-#define DO_ZPZ(NAME, name) \
-static bool trans_##NAME(DisasContext *s, arg_rpr_esz *a)           \
-{                                                                   \
-    static gen_helper_gvec_3 * const fns[4] = {                     \
-        gen_helper_sve_##name##_b, gen_helper_sve_##name##_h,       \
-        gen_helper_sve_##name##_s, gen_helper_sve_##name##_d,       \
+#define DO_ZPZ(NAME, FEAT, name) \
+    static gen_helper_gvec_3 * const name##_fns[4] = {              \
+        gen_helper_##name##_b, gen_helper_##name##_h,               \
+        gen_helper_##name##_s, gen_helper_##name##_d,               \
     };                                                              \
-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);              \
-}
+    TRANS_FEAT(NAME, FEAT, gen_gvec_ool_arg_zpz, name##_fns[a->esz], a, 0)
 
-DO_ZPZ(CLS, cls)
-DO_ZPZ(CLZ, clz)
-DO_ZPZ(CNT_zpz, cnt_zpz)
-DO_ZPZ(CNOT, cnot)
-DO_ZPZ(NOT_zpz, not_zpz)
-DO_ZPZ(ABS, abs)
-DO_ZPZ(NEG, neg)
+DO_ZPZ(CLS, aa64_sve, sve_cls)
+DO_ZPZ(CLZ, aa64_sve, sve_clz)
+DO_ZPZ(CNT_zpz, aa64_sve, sve_cnt_zpz)
+DO_ZPZ(CNOT, aa64_sve, sve_cnot)
+DO_ZPZ(NOT_zpz, aa64_sve, sve_not_zpz)
+DO_ZPZ(ABS, aa64_sve, sve_abs)
+DO_ZPZ(NEG, aa64_sve, sve_neg)
+DO_ZPZ(RBIT, aa64_sve, sve_rbit)
 
-static bool trans_FABS(DisasContext *s, arg_rpr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        NULL,
-        gen_helper_sve_fabs_h,
-        gen_helper_sve_fabs_s,
-        gen_helper_sve_fabs_d
-    };
-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
-}
+static gen_helper_gvec_3 * const fabs_fns[4] = {
+    NULL,                  gen_helper_sve_fabs_h,
+    gen_helper_sve_fabs_s, gen_helper_sve_fabs_d,
+};
+TRANS_FEAT(FABS, aa64_sve, gen_gvec_ool_arg_zpz, fabs_fns[a->esz], a, 0)
 
-static bool trans_FNEG(DisasContext *s, arg_rpr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        NULL,
-        gen_helper_sve_fneg_h,
-        gen_helper_sve_fneg_s,
-        gen_helper_sve_fneg_d
-    };
-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
-}
+static gen_helper_gvec_3 * const fneg_fns[4] = {
+    NULL,                  gen_helper_sve_fneg_h,
+    gen_helper_sve_fneg_s, gen_helper_sve_fneg_d,
+};
+TRANS_FEAT(FNEG, aa64_sve, gen_gvec_ool_arg_zpz, fneg_fns[a->esz], a, 0)
 
-static bool trans_SXTB(DisasContext *s, arg_rpr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        NULL,
-        gen_helper_sve_sxtb_h,
-        gen_helper_sve_sxtb_s,
-        gen_helper_sve_sxtb_d
-    };
-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
-}
+static gen_helper_gvec_3 * const sxtb_fns[4] = {
+    NULL,                  gen_helper_sve_sxtb_h,
+    gen_helper_sve_sxtb_s, gen_helper_sve_sxtb_d,
+};
+TRANS_FEAT(SXTB, aa64_sve, gen_gvec_ool_arg_zpz, sxtb_fns[a->esz], a, 0)
 
-static bool trans_UXTB(DisasContext *s, arg_rpr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        NULL,
-        gen_helper_sve_uxtb_h,
-        gen_helper_sve_uxtb_s,
-        gen_helper_sve_uxtb_d
-    };
-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
-}
+static gen_helper_gvec_3 * const uxtb_fns[4] = {
+    NULL,                  gen_helper_sve_uxtb_h,
+    gen_helper_sve_uxtb_s, gen_helper_sve_uxtb_d,
+};
+TRANS_FEAT(UXTB, aa64_sve, gen_gvec_ool_arg_zpz, uxtb_fns[a->esz], a, 0)
 
-static bool trans_SXTH(DisasContext *s, arg_rpr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        NULL, NULL,
-        gen_helper_sve_sxth_s,
-        gen_helper_sve_sxth_d
-    };
-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
-}
+static gen_helper_gvec_3 * const sxth_fns[4] = {
+    NULL, NULL, gen_helper_sve_sxth_s, gen_helper_sve_sxth_d
+};
+TRANS_FEAT(SXTH, aa64_sve, gen_gvec_ool_arg_zpz, sxth_fns[a->esz], a, 0)
 
-static bool trans_UXTH(DisasContext *s, arg_rpr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        NULL, NULL,
-        gen_helper_sve_uxth_s,
-        gen_helper_sve_uxth_d
-    };
-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
-}
+static gen_helper_gvec_3 * const uxth_fns[4] = {
+    NULL, NULL, gen_helper_sve_uxth_s, gen_helper_sve_uxth_d
+};
+TRANS_FEAT(UXTH, aa64_sve, gen_gvec_ool_arg_zpz, uxth_fns[a->esz], a, 0)
 
-static bool trans_SXTW(DisasContext *s, arg_rpr_esz *a)
-{
-    return gen_gvec_ool_arg_zpz(s, a->esz == 3 ? gen_helper_sve_sxtw_d
-                                : NULL, a, 0);
-}
-
-static bool trans_UXTW(DisasContext *s, arg_rpr_esz *a)
-{
-    return gen_gvec_ool_arg_zpz(s, a->esz == 3 ? gen_helper_sve_uxtw_d
-                                : NULL, a, 0);
-}
-
-#undef DO_ZPZ
+TRANS_FEAT(SXTW, aa64_sve, gen_gvec_ool_arg_zpz,
+           a->esz == 3 ? gen_helper_sve_sxtw_d : NULL, a, 0)
+TRANS_FEAT(UXTW, aa64_sve, gen_gvec_ool_arg_zpz,
+           a->esz == 3 ? gen_helper_sve_uxtw_d : NULL, a, 0)
 
 /*
  *** SVE Integer Reduction Group
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(TRN2_q, aa64_sve_f64mm, gen_gvec_ool_arg_zzz,
  *** SVE Permute Vector - Predicated Group
  */
 
-static bool trans_COMPACT(DisasContext *s, arg_rpr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        NULL, NULL, gen_helper_sve_compact_s, gen_helper_sve_compact_d
-    };
-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
-}
+static gen_helper_gvec_3 * const compact_fns[4] = {
+    NULL, NULL, gen_helper_sve_compact_s, gen_helper_sve_compact_d
+};
+TRANS_FEAT(COMPACT, aa64_sve, gen_gvec_ool_arg_zpz, compact_fns[a->esz], a, 0)
 
 /* Call the helper that computes the ARM LastActiveElement pseudocode
  * function, scaled by the element size.  This includes the not found
@@ -XXX,XX +XXX,XX @@ static bool trans_CPY_m_v(DisasContext *s, arg_rpr_esz *a)
     return true;
 }
 
-static bool trans_REVB(DisasContext *s, arg_rpr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        NULL,
-        gen_helper_sve_revb_h,
-        gen_helper_sve_revb_s,
-        gen_helper_sve_revb_d,
-    };
-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
-}
+static gen_helper_gvec_3 * const revb_fns[4] = {
+    NULL,                  gen_helper_sve_revb_h,
+    gen_helper_sve_revb_s, gen_helper_sve_revb_d,
+};
+TRANS_FEAT(REVB, aa64_sve, gen_gvec_ool_arg_zpz, revb_fns[a->esz], a, 0)
 
-static bool trans_REVH(DisasContext *s, arg_rpr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        NULL,
-        NULL,
-        gen_helper_sve_revh_s,
-        gen_helper_sve_revh_d,
-    };
-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
-}
+static gen_helper_gvec_3 * const revh_fns[4] = {
+    NULL, NULL, gen_helper_sve_revh_s, gen_helper_sve_revh_d,
+};
+TRANS_FEAT(REVH, aa64_sve, gen_gvec_ool_arg_zpz, revh_fns[a->esz], a, 0)
 
-static bool trans_REVW(DisasContext *s, arg_rpr_esz *a)
-{
-    return gen_gvec_ool_arg_zpz(s, a->esz == 3 ? gen_helper_sve_revw_d
-                                : NULL, a, 0);
-}
-
-static bool trans_RBIT(DisasContext *s, arg_rpr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_sve_rbit_b,
-        gen_helper_sve_rbit_h,
-        gen_helper_sve_rbit_s,
-        gen_helper_sve_rbit_d,
-    };
-    return gen_gvec_ool_arg_zpz(s, fns[a->esz], a, 0);
-}
+TRANS_FEAT(REVW, aa64_sve, gen_gvec_ool_arg_zpz,
+           a->esz == 3 ? gen_helper_sve_revw_d : NULL, a, 0)
 
 static bool trans_SPLICE(DisasContext *s, arg_rprr_esz *a)
 {
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions using do_sve2_zpz_data
to use TRANS_FEAT and gen_gvec_ool_arg_zpz.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-23-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 53 ++++++++++----------------------------
 1 file changed, 14 insertions(+), 39 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_UADALP_zpzz(DisasContext *s, arg_rprr_esz *a)
  * SVE2 integer unary operations (predicated)
  */
 
-static bool do_sve2_zpz_ool(DisasContext *s, arg_rpr_esz *a,
-                            gen_helper_gvec_3 *fn)
-{
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zpz(s, fn, a, 0);
-}
+TRANS_FEAT(URECPE, aa64_sve2, gen_gvec_ool_arg_zpz,
+           a->esz == 2 ? gen_helper_sve2_urecpe_s : NULL, a, 0)
 
-static bool trans_URECPE(DisasContext *s, arg_rpr_esz *a)
-{
-    if (a->esz != 2) {
-        return false;
-    }
-    return do_sve2_zpz_ool(s, a, gen_helper_sve2_urecpe_s);
-}
+TRANS_FEAT(URSQRTE, aa64_sve2, gen_gvec_ool_arg_zpz,
+           a->esz == 2 ? gen_helper_sve2_ursqrte_s : NULL, a, 0)
 
-static bool trans_URSQRTE(DisasContext *s, arg_rpr_esz *a)
-{
-    if (a->esz != 2) {
-        return false;
-    }
-    return do_sve2_zpz_ool(s, a, gen_helper_sve2_ursqrte_s);
-}
+static gen_helper_gvec_3 * const sqabs_fns[4] = {
+    gen_helper_sve2_sqabs_b, gen_helper_sve2_sqabs_h,
+    gen_helper_sve2_sqabs_s, gen_helper_sve2_sqabs_d,
+};
+TRANS_FEAT(SQABS, aa64_sve2, gen_gvec_ool_arg_zpz, sqabs_fns[a->esz], a, 0)
 
-static bool trans_SQABS(DisasContext *s, arg_rpr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_sve2_sqabs_b, gen_helper_sve2_sqabs_h,
-        gen_helper_sve2_sqabs_s, gen_helper_sve2_sqabs_d,
-    };
-    return do_sve2_zpz_ool(s, a, fns[a->esz]);
-}
-
-static bool trans_SQNEG(DisasContext *s, arg_rpr_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_sve2_sqneg_b, gen_helper_sve2_sqneg_h,
-        gen_helper_sve2_sqneg_s, gen_helper_sve2_sqneg_d,
-    };
-    return do_sve2_zpz_ool(s, a, fns[a->esz]);
-}
+static gen_helper_gvec_3 * const sqneg_fns[4] = {
+    gen_helper_sve2_sqneg_b, gen_helper_sve2_sqneg_h,
+    gen_helper_sve2_sqneg_s, gen_helper_sve2_sqneg_d,
+};
+TRANS_FEAT(SQNEG, aa64_sve2, gen_gvec_ool_arg_zpz, sqneg_fns[a->esz], a, 0)
 
 #define DO_SVE2_ZPZZ(NAME, name) \
 static bool trans_##NAME(DisasContext *s, arg_rprr_esz *a)                \
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Rename the function to match gen_gvec_ool_arg_zpz,
and move to be adjacent.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-24-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 29 ++++++++++++++---------------
 1 file changed, 14 insertions(+), 15 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Convert some SVE translation functions using
gen_gvec_ool_arg_zpzi to TRANS_FEAT.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-25-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 85 ++++++++++++++------------------------
 1 file changed, 30 insertions(+), 55 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_ASRD(DisasContext *s, arg_rpri_esz *a)
     }
 }
 
-static bool trans_SQSHL_zpzi(DisasContext *s, arg_rpri_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_sve2_sqshl_zpzi_b, gen_helper_sve2_sqshl_zpzi_h,
-        gen_helper_sve2_sqshl_zpzi_s, gen_helper_sve2_sqshl_zpzi_d,
-    };
-    if (a->esz < 0 || !dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
-}
+static gen_helper_gvec_3 * const sqshl_zpzi_fns[4] = {
+    gen_helper_sve2_sqshl_zpzi_b, gen_helper_sve2_sqshl_zpzi_h,
+    gen_helper_sve2_sqshl_zpzi_s, gen_helper_sve2_sqshl_zpzi_d,
+};
+TRANS_FEAT(SQSHL_zpzi, aa64_sve2, gen_gvec_ool_arg_zpzi,
+           a->esz < 0 ? NULL : sqshl_zpzi_fns[a->esz], a)
 
-static bool trans_UQSHL_zpzi(DisasContext *s, arg_rpri_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_sve2_uqshl_zpzi_b, gen_helper_sve2_uqshl_zpzi_h,
-        gen_helper_sve2_uqshl_zpzi_s, gen_helper_sve2_uqshl_zpzi_d,
-    };
-    if (a->esz < 0 || !dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
-}
+static gen_helper_gvec_3 * const uqshl_zpzi_fns[4] = {
+    gen_helper_sve2_uqshl_zpzi_b, gen_helper_sve2_uqshl_zpzi_h,
+    gen_helper_sve2_uqshl_zpzi_s, gen_helper_sve2_uqshl_zpzi_d,
+};
+TRANS_FEAT(UQSHL_zpzi, aa64_sve2, gen_gvec_ool_arg_zpzi,
+           a->esz < 0 ? NULL : uqshl_zpzi_fns[a->esz], a)
 
-static bool trans_SRSHR(DisasContext *s, arg_rpri_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_sve2_srshr_b, gen_helper_sve2_srshr_h,
-        gen_helper_sve2_srshr_s, gen_helper_sve2_srshr_d,
-    };
-    if (a->esz < 0 || !dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
-}
+static gen_helper_gvec_3 * const srshr_fns[4] = {
+    gen_helper_sve2_srshr_b, gen_helper_sve2_srshr_h,
+    gen_helper_sve2_srshr_s, gen_helper_sve2_srshr_d,
+};
+TRANS_FEAT(SRSHR, aa64_sve2, gen_gvec_ool_arg_zpzi,
+           a->esz < 0 ? NULL : srshr_fns[a->esz], a)
 
-static bool trans_URSHR(DisasContext *s, arg_rpri_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_sve2_urshr_b, gen_helper_sve2_urshr_h,
-        gen_helper_sve2_urshr_s, gen_helper_sve2_urshr_d,
-    };
-    if (a->esz < 0 || !dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
-}
+static gen_helper_gvec_3 * const urshr_fns[4] = {
+    gen_helper_sve2_urshr_b, gen_helper_sve2_urshr_h,
+    gen_helper_sve2_urshr_s, gen_helper_sve2_urshr_d,
+};
+TRANS_FEAT(URSHR, aa64_sve2, gen_gvec_ool_arg_zpzi,
+           a->esz < 0 ? NULL : urshr_fns[a->esz], a)
 
-static bool trans_SQSHLU(DisasContext *s, arg_rpri_esz *a)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_sve2_sqshlu_b, gen_helper_sve2_sqshlu_h,
-        gen_helper_sve2_sqshlu_s, gen_helper_sve2_sqshlu_d,
-    };
-    if (a->esz < 0 || !dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zpzi(s, fns[a->esz], a);
-}
+static gen_helper_gvec_3 * const sqshlu_fns[4] = {
+    gen_helper_sve2_sqshlu_b, gen_helper_sve2_sqshlu_h,
+    gen_helper_sve2_sqshlu_s, gen_helper_sve2_sqshlu_d,
+};
+TRANS_FEAT(SQSHLU, aa64_sve2, gen_gvec_ool_arg_zpzi,
+           a->esz < 0 ? NULL : sqshlu_fns[a->esz], a)
 
 /*
  *** SVE Bitwise Shift - Predicated Group
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-26-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 42 ++++++++++++++++----------------------
 1 file changed, 18 insertions(+), 24 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Use gen_gvec_ool_arg_zpzz instead of gen_gvec_ool_zzzp
when the arguments come from arg_rprr_esz.
Replaces do_zpzz_ool.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-27-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 21 +++++++++++----------
 1 file changed, 11 insertions(+), 10 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions directly using
gen_gvec_ool_arg_zpzz to TRANS_FEAT.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-28-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 85 ++++++++++++++++----------------------
 1 file changed, 36 insertions(+), 49 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static void do_sel_z(DisasContext *s, int rd, int rn, int rm, int pg, int esz)
     gen_gvec_ool_zzzp(s, fns[esz], rd, rn, rm, pg, 0);
 }
 
-#define DO_ZPZZ(NAME, name) \
-static bool trans_##NAME##_zpzz(DisasContext *s, arg_rprr_esz *a)         \
-{                                                                         \
-    static gen_helper_gvec_4 * const fns[4] = {                           \
-        gen_helper_sve_##name##_zpzz_b, gen_helper_sve_##name##_zpzz_h,   \
-        gen_helper_sve_##name##_zpzz_s, gen_helper_sve_##name##_zpzz_d,   \
+#define DO_ZPZZ(NAME, FEAT, name) \
+    static gen_helper_gvec_4 * const name##_zpzz_fns[4] = {               \
+        gen_helper_##name##_zpzz_b, gen_helper_##name##_zpzz_h,           \
+        gen_helper_##name##_zpzz_s, gen_helper_##name##_zpzz_d,           \
     };                                                                    \
-    return gen_gvec_ool_arg_zpzz(s, fns[a->esz], a, 0);                   \
-}
+    TRANS_FEAT(NAME, FEAT, gen_gvec_ool_arg_zpzz,                         \
+               name##_zpzz_fns[a->esz], a, 0)
 
-DO_ZPZZ(AND, and)
-DO_ZPZZ(EOR, eor)
-DO_ZPZZ(ORR, orr)
-DO_ZPZZ(BIC, bic)
+DO_ZPZZ(AND_zpzz, aa64_sve, sve_and)
+DO_ZPZZ(EOR_zpzz, aa64_sve, sve_eor)
+DO_ZPZZ(ORR_zpzz, aa64_sve, sve_orr)
+DO_ZPZZ(BIC_zpzz, aa64_sve, sve_bic)
 
-DO_ZPZZ(ADD, add)
-DO_ZPZZ(SUB, sub)
+DO_ZPZZ(ADD_zpzz, aa64_sve, sve_add)
+DO_ZPZZ(SUB_zpzz, aa64_sve, sve_sub)
 
-DO_ZPZZ(SMAX, smax)
-DO_ZPZZ(UMAX, umax)
-DO_ZPZZ(SMIN, smin)
-DO_ZPZZ(UMIN, umin)
-DO_ZPZZ(SABD, sabd)
-DO_ZPZZ(UABD, uabd)
+DO_ZPZZ(SMAX_zpzz, aa64_sve, sve_smax)
+DO_ZPZZ(UMAX_zpzz, aa64_sve, sve_umax)
+DO_ZPZZ(SMIN_zpzz, aa64_sve, sve_smin)
+DO_ZPZZ(UMIN_zpzz, aa64_sve, sve_umin)
+DO_ZPZZ(SABD_zpzz, aa64_sve, sve_sabd)
+DO_ZPZZ(UABD_zpzz, aa64_sve, sve_uabd)
 
-DO_ZPZZ(MUL, mul)
-DO_ZPZZ(SMULH, smulh)
-DO_ZPZZ(UMULH, umulh)
+DO_ZPZZ(MUL_zpzz, aa64_sve, sve_mul)
+DO_ZPZZ(SMULH_zpzz, aa64_sve, sve_smulh)
+DO_ZPZZ(UMULH_zpzz, aa64_sve, sve_umulh)
 
-DO_ZPZZ(ASR, asr)
-DO_ZPZZ(LSR, lsr)
-DO_ZPZZ(LSL, lsl)
+DO_ZPZZ(ASR_zpzz, aa64_sve, sve_asr)
+DO_ZPZZ(LSR_zpzz, aa64_sve, sve_lsr)
+DO_ZPZZ(LSL_zpzz, aa64_sve, sve_lsl)
 
-static bool trans_SDIV_zpzz(DisasContext *s, arg_rprr_esz *a)
-{
-    static gen_helper_gvec_4 * const fns[4] = {
-        NULL, NULL, gen_helper_sve_sdiv_zpzz_s, gen_helper_sve_sdiv_zpzz_d
-    };
-    return gen_gvec_ool_arg_zpzz(s, fns[a->esz], a, 0);
-}
+static gen_helper_gvec_4 * const sdiv_fns[4] = {
+    NULL, NULL, gen_helper_sve_sdiv_zpzz_s, gen_helper_sve_sdiv_zpzz_d
+};
+TRANS_FEAT(SDIV_zpzz, aa64_sve, gen_gvec_ool_arg_zpzz, sdiv_fns[a->esz], a, 0)
 
-static bool trans_UDIV_zpzz(DisasContext *s, arg_rprr_esz *a)
-{
-    static gen_helper_gvec_4 * const fns[4] = {
-        NULL, NULL, gen_helper_sve_udiv_zpzz_s, gen_helper_sve_udiv_zpzz_d
-    };
-    return gen_gvec_ool_arg_zpzz(s, fns[a->esz], a, 0);
-}
+static gen_helper_gvec_4 * const udiv_fns[4] = {
+    NULL, NULL, gen_helper_sve_udiv_zpzz_s, gen_helper_sve_udiv_zpzz_d
+};
+TRANS_FEAT(UDIV_zpzz, aa64_sve, gen_gvec_ool_arg_zpzz, udiv_fns[a->esz], a, 0)
 
 static bool trans_SEL_zpzz(DisasContext *s, arg_rprr_esz *a)
 {
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(SQSHLU, aa64_sve2, gen_gvec_ool_arg_zpzi,
  */
 
 #define DO_ZPZW(NAME, name) \
-static bool trans_##NAME##_zpzw(DisasContext *s, arg_rprr_esz *a)         \
-{                                                                         \
-    static gen_helper_gvec_4 * const fns[3] = {                           \
+    static gen_helper_gvec_4 * const name##_zpzw_fns[4] = {               \
         gen_helper_sve_##name##_zpzw_b, gen_helper_sve_##name##_zpzw_h,   \
-        gen_helper_sve_##name##_zpzw_s,                                   \
+        gen_helper_sve_##name##_zpzw_s, NULL                              \
     };                                                                    \
-    if (a->esz < 0 || a->esz >= 3) {                                      \
-        return false;                                                     \
-    }                                                                     \
-    return gen_gvec_ool_arg_zpzz(s, fns[a->esz], a, 0);                   \
-}
+    TRANS_FEAT(NAME##_zpzw, aa64_sve, gen_gvec_ool_arg_zpzz,              \
+               a->esz < 0 ? NULL : name##_zpzw_fns[a->esz], a, 0)
 
 DO_ZPZW(ASR, asr)
 DO_ZPZW(LSR, lsr)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions using do_sve2_zpzz_ool
to use TRANS_FEAT and gen_gvec_ool_arg_zpzz.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-29-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 118 +++++++++++++------------------------
 1 file changed, 40 insertions(+), 78 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_SEL_zpzz(DisasContext *s, arg_rprr_esz *a)
     return true;
 }
 
-#undef DO_ZPZZ
-
 /*
  *** SVE Integer Arithmetic - Unary Predicated Group
  */
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(SQRDMULH_zzz, aa64_sve2, gen_gvec_ool_arg_zzz,
  * SVE2 Integer - Predicated
  */
 
-static bool do_sve2_zpzz_ool(DisasContext *s, arg_rprr_esz *a,
-                             gen_helper_gvec_4 *fn)
-{
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zpzz(s, fn, a, 0);
-}
+static gen_helper_gvec_4 * const sadlp_fns[4] = {
+    NULL,                          gen_helper_sve2_sadalp_zpzz_h,
+    gen_helper_sve2_sadalp_zpzz_s, gen_helper_sve2_sadalp_zpzz_d,
+};
+TRANS_FEAT(SADALP_zpzz, aa64_sve2, gen_gvec_ool_arg_zpzz,
+           sadlp_fns[a->esz], a, 0)
 
-static bool trans_SADALP_zpzz(DisasContext *s, arg_rprr_esz *a)
-{
-    static gen_helper_gvec_4 * const fns[3] = {
-        gen_helper_sve2_sadalp_zpzz_h,
-        gen_helper_sve2_sadalp_zpzz_s,
-        gen_helper_sve2_sadalp_zpzz_d,
-    };
-    if (a->esz == 0) {
-        return false;
-    }
-    return do_sve2_zpzz_ool(s, a, fns[a->esz - 1]);
-}
-
-static bool trans_UADALP_zpzz(DisasContext *s, arg_rprr_esz *a)
-{
-    static gen_helper_gvec_4 * const fns[3] = {
-        gen_helper_sve2_uadalp_zpzz_h,
-        gen_helper_sve2_uadalp_zpzz_s,
-        gen_helper_sve2_uadalp_zpzz_d,
-    };
-    if (a->esz == 0) {
-        return false;
-    }
-    return do_sve2_zpzz_ool(s, a, fns[a->esz - 1]);
-}
+static gen_helper_gvec_4 * const uadlp_fns[4] = {
+    NULL,                          gen_helper_sve2_uadalp_zpzz_h,
+    gen_helper_sve2_uadalp_zpzz_s, gen_helper_sve2_uadalp_zpzz_d,
+};
+TRANS_FEAT(UADALP_zpzz, aa64_sve2, gen_gvec_ool_arg_zpzz,
+           uadlp_fns[a->esz], a, 0)
 
 /*
  * SVE2 integer unary operations (predicated)
@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_3 * const sqneg_fns[4] = {
 };
 TRANS_FEAT(SQNEG, aa64_sve2, gen_gvec_ool_arg_zpz, sqneg_fns[a->esz], a, 0)
 
-#define DO_SVE2_ZPZZ(NAME, name) \
-static bool trans_##NAME(DisasContext *s, arg_rprr_esz *a)                \
-{                                                                         \
-    static gen_helper_gvec_4 * const fns[4] = {                           \
-        gen_helper_sve2_##name##_zpzz_b, gen_helper_sve2_##name##_zpzz_h, \
-        gen_helper_sve2_##name##_zpzz_s, gen_helper_sve2_##name##_zpzz_d, \
-    };                                                                    \
-    return do_sve2_zpzz_ool(s, a, fns[a->esz]);                           \
-}
+DO_ZPZZ(SQSHL, aa64_sve2, sve2_sqshl)
+DO_ZPZZ(SQRSHL, aa64_sve2, sve2_sqrshl)
+DO_ZPZZ(SRSHL, aa64_sve2, sve2_srshl)
 
-DO_SVE2_ZPZZ(SQSHL, sqshl)
-DO_SVE2_ZPZZ(SQRSHL, sqrshl)
-DO_SVE2_ZPZZ(SRSHL, srshl)
+DO_ZPZZ(UQSHL, aa64_sve2, sve2_uqshl)
+DO_ZPZZ(UQRSHL, aa64_sve2, sve2_uqrshl)
+DO_ZPZZ(URSHL, aa64_sve2, sve2_urshl)
 
-DO_SVE2_ZPZZ(UQSHL, uqshl)
-DO_SVE2_ZPZZ(UQRSHL, uqrshl)
-DO_SVE2_ZPZZ(URSHL, urshl)
+DO_ZPZZ(SHADD, aa64_sve2, sve2_shadd)
+DO_ZPZZ(SRHADD, aa64_sve2, sve2_srhadd)
+DO_ZPZZ(SHSUB, aa64_sve2, sve2_shsub)
 
-DO_SVE2_ZPZZ(SHADD, shadd)
-DO_SVE2_ZPZZ(SRHADD, srhadd)
-DO_SVE2_ZPZZ(SHSUB, shsub)
+DO_ZPZZ(UHADD, aa64_sve2, sve2_uhadd)
+DO_ZPZZ(URHADD, aa64_sve2, sve2_urhadd)
+DO_ZPZZ(UHSUB, aa64_sve2, sve2_uhsub)
 
-DO_SVE2_ZPZZ(UHADD, uhadd)
-DO_SVE2_ZPZZ(URHADD, urhadd)
-DO_SVE2_ZPZZ(UHSUB, uhsub)
+DO_ZPZZ(ADDP, aa64_sve2, sve2_addp)
+DO_ZPZZ(SMAXP, aa64_sve2, sve2_smaxp)
+DO_ZPZZ(UMAXP, aa64_sve2, sve2_umaxp)
+DO_ZPZZ(SMINP, aa64_sve2, sve2_sminp)
+DO_ZPZZ(UMINP, aa64_sve2, sve2_uminp)
 
-DO_SVE2_ZPZZ(ADDP, addp)
-DO_SVE2_ZPZZ(SMAXP, smaxp)
-DO_SVE2_ZPZZ(UMAXP, umaxp)
-DO_SVE2_ZPZZ(SMINP, sminp)
-DO_SVE2_ZPZZ(UMINP, uminp)
-
-DO_SVE2_ZPZZ(SQADD_zpzz, sqadd)
-DO_SVE2_ZPZZ(UQADD_zpzz, uqadd)
-DO_SVE2_ZPZZ(SQSUB_zpzz, sqsub)
-DO_SVE2_ZPZZ(UQSUB_zpzz, uqsub)
-DO_SVE2_ZPZZ(SUQADD, suqadd)
-DO_SVE2_ZPZZ(USQADD, usqadd)
+DO_ZPZZ(SQADD_zpzz, aa64_sve2, sve2_sqadd)
+DO_ZPZZ(UQADD_zpzz, aa64_sve2, sve2_uqadd)
+DO_ZPZZ(SQSUB_zpzz, aa64_sve2, sve2_sqsub)
+DO_ZPZZ(UQSUB_zpzz, aa64_sve2, sve2_uqsub)
+DO_ZPZZ(SUQADD, aa64_sve2, sve2_suqadd)
+DO_ZPZZ(USQADD, aa64_sve2, sve2_usqadd)
 
 /*
  * SVE2 Widening Integer Arithmetic
@@ -XXX,XX +XXX,XX @@ static bool trans_##NAME(DisasContext *s, arg_rprr_esz *a)                  \
 DO_SVE2_PPZZ_MATCH(MATCH, match)
 DO_SVE2_PPZZ_MATCH(NMATCH, nmatch)
 
-static bool trans_HISTCNT(DisasContext *s, arg_rprr_esz *a)
-{
-    static gen_helper_gvec_4 * const fns[2] = {
-        gen_helper_sve2_histcnt_s, gen_helper_sve2_histcnt_d
-    };
-    if (a->esz < 2) {
-        return false;
-    }
-    return do_sve2_zpzz_ool(s, a, fns[a->esz - 2]);
-}
+static gen_helper_gvec_4 * const histcnt_fns[4] = {
+    NULL, NULL, gen_helper_sve2_histcnt_s, gen_helper_sve2_histcnt_d
+};
+TRANS_FEAT(HISTCNT, aa64_sve2, gen_gvec_ool_arg_zpzz,
+           histcnt_fns[a->esz], a, 0)
 
 TRANS_FEAT(HISTSEG, aa64_sve2, gen_gvec_ool_arg_zzz,
            a->esz == 0 ? gen_helper_sve2_histseg : NULL, a, 0)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

There is only one caller for gen_gvec_fn_zz; inline it.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-30-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 13 +++----------
 1 file changed, 3 insertions(+), 10 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-31-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 36 +++++++++++++++---------------------
 1 file changed, 15 insertions(+), 21 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Rename the function to match gen_gvec_fn_zzz,
and move to be adjacent.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-32-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 31 ++++++++++++++++---------------
 1 file changed, 16 insertions(+), 15 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Two uses of gen_gvec_fn_zzz can pass on arg_rrr_esz instead.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-33-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 4 ++--
 1 file changed, 2 insertions(+), 2 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_MUL_zzz(DisasContext *s, arg_rrr_esz *a)
     if (!dc_isar_feature(aa64_sve2, s)) {
         return false;
     }
-    return gen_gvec_fn_zzz(s, tcg_gen_gvec_mul, a->esz, a->rd, a->rn, a->rm);
+    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_mul, a);
 }
 
 static gen_helper_gvec_3 * const smulh_zzz_fns[4] = {
@@ -XXX,XX +XXX,XX @@ static bool do_sve2_fn_zzz(DisasContext *s, arg_rrr_esz *a, GVecGen3Fn *fn)
     if (!dc_isar_feature(aa64_sve2, s)) {
         return false;
     }
-    return gen_gvec_fn_zzz(s, fn, a->esz, a->rd, a->rn, a->rm);
+    return gen_gvec_fn_arg_zzz(s, fn, a);
 }
 
 static bool trans_SABA(DisasContext *s, arg_rrr_esz *a)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions directly using
gen_gvec_fn_arg_zzz to TRANS_FEAT.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-34-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 66 +++++++-------------------------------
 1 file changed, 11 insertions(+), 55 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ const uint64_t pred_esz_masks[4] = {
  *** SVE Logical - Unpredicated Group
  */
 
-static bool trans_AND_zzz(DisasContext *s, arg_rrr_esz *a)
-{
-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_and, a);
-}
-
-static bool trans_ORR_zzz(DisasContext *s, arg_rrr_esz *a)
-{
-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_or, a);
-}
-
-static bool trans_EOR_zzz(DisasContext *s, arg_rrr_esz *a)
-{
-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_xor, a);
-}
-
-static bool trans_BIC_zzz(DisasContext *s, arg_rrr_esz *a)
-{
-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_andc, a);
-}
+TRANS_FEAT(AND_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_and, a)
+TRANS_FEAT(ORR_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_or, a)
+TRANS_FEAT(EOR_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_xor, a)
+TRANS_FEAT(BIC_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_andc, a)
 
 static void gen_xar8_i64(TCGv_i64 d, TCGv_i64 n, TCGv_i64 m, int64_t sh)
 {
@@ -XXX,XX +XXX,XX @@ static bool trans_NBSL(DisasContext *s, arg_rrrr_esz *a)
  *** SVE Integer Arithmetic - Unpredicated Group
  */
 
-static bool trans_ADD_zzz(DisasContext *s, arg_rrr_esz *a)
-{
-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_add, a);
-}
-
-static bool trans_SUB_zzz(DisasContext *s, arg_rrr_esz *a)
-{
-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_sub, a);
-}
-
-static bool trans_SQADD_zzz(DisasContext *s, arg_rrr_esz *a)
-{
-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_ssadd, a);
-}
-
-static bool trans_SQSUB_zzz(DisasContext *s, arg_rrr_esz *a)
-{
-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_sssub, a);
-}
-
-static bool trans_UQADD_zzz(DisasContext *s, arg_rrr_esz *a)
-{
-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_usadd, a);
-}
-
-static bool trans_UQSUB_zzz(DisasContext *s, arg_rrr_esz *a)
-{
-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_ussub, a);
-}
+TRANS_FEAT(ADD_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_add, a)
+TRANS_FEAT(SUB_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_sub, a)
+TRANS_FEAT(SQADD_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_ssadd, a)
+TRANS_FEAT(SQSUB_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_sssub, a)
+TRANS_FEAT(UQADD_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_usadd, a)
+TRANS_FEAT(UQSUB_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_ussub, a)
 
 /*
  *** SVE Integer Arithmetic - Binary Predicated Group
@@ -XXX,XX +XXX,XX @@ static bool trans_MOVPRFX_z(DisasContext *s, arg_rpr_esz *a)
  * SVE2 Integer Multiply - Unpredicated
  */
 
-static bool trans_MUL_zzz(DisasContext *s, arg_rrr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_fn_arg_zzz(s, tcg_gen_gvec_mul, a);
-}
+TRANS_FEAT(MUL_zzz, aa64_sve2, gen_gvec_fn_arg_zzz, tcg_gen_gvec_mul, a)
 
 static gen_helper_gvec_3 * const smulh_zzz_fns[4] = {
     gen_helper_gvec_smulh_b, gen_helper_gvec_smulh_h,
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions using do_sve2_fn_zzz
to use TRANS_FEAT and gen_gvec_fn_arg_zzz.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-35-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 19 ++-----------------
 1 file changed, 2 insertions(+), 17 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_SLI(DisasContext *s, arg_rri_esz *a)
     return do_sve2_fn2i(s, a, gen_gvec_sli);
 }
 
-static bool do_sve2_fn_zzz(DisasContext *s, arg_rrr_esz *a, GVecGen3Fn *fn)
-{
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_fn_arg_zzz(s, fn, a);
-}
-
-static bool trans_SABA(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_sve2_fn_zzz(s, a, gen_gvec_saba);
-}
-
-static bool trans_UABA(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_sve2_fn_zzz(s, a, gen_gvec_uaba);
-}
+TRANS_FEAT(SABA, aa64_sve2, gen_gvec_fn_arg_zzz, gen_gvec_saba, a)
+TRANS_FEAT(UABA, aa64_sve2, gen_gvec_fn_arg_zzz, gen_gvec_uaba, a)
 
 static bool do_sve2_narrow_extract(DisasContext *s, arg_rri_esz *a,
                                    const GVecGen2 ops[3])
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

The decode for RAX1 sets esz to MO_8, because that's what
we use by default for "no esz present".  We changed that
to MO_64 during translation because it is more logical for
the operation.  However, the esz argument to gen_gvec_rax1
is unused and forces MO_64 within that function, so there
is no need to do it here as well.

Simplify to use gen_gvec_fn_arg_zzz and TRANS_FEAT.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-36-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 8 +-------
 1 file changed, 1 insertion(+), 7 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(SM4E, aa64_sve2_sm4, gen_gvec_ool_arg_zzz,
 TRANS_FEAT(SM4EKEY, aa64_sve2_sm4, gen_gvec_ool_arg_zzz,
            gen_helper_crypto_sm4ekey, a, 0)
 
-static bool trans_RAX1(DisasContext *s, arg_rrr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve2_sha3, s)) {
-        return false;
-    }
-    return gen_gvec_fn_zzz(s, gen_gvec_rax1, MO_64, a->rd, a->rn, a->rm);
-}
+TRANS_FEAT(RAX1, aa64_sve2_sha3, gen_gvec_fn_arg_zzz, gen_gvec_rax1, a)
 
 static bool trans_FCVTNT_sh(DisasContext *s, arg_rpr_esz *a)
 {
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Merge gen_gvec_fn_zzzz with the sve access check and the
dereference of arg_rrrr_esz.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-37-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 25 ++++++++++++++-----------
 1 file changed, 14 insertions(+), 11 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_fn_arg_zzz(DisasContext *s, GVecGen3Fn *fn,
 }
 
 /* Invoke a vector expander on four Zregs.  */
-static void gen_gvec_fn_zzzz(DisasContext *s, GVecGen4Fn *gvec_fn,
-                             int esz, int rd, int rn, int rm, int ra)
+static bool gen_gvec_fn_arg_zzzz(DisasContext *s, GVecGen4Fn *gvec_fn,
+                                 arg_rrrr_esz *a)
 {
-    unsigned vsz = vec_full_reg_size(s);
-    gvec_fn(esz, vec_full_reg_offset(s, rd),
-            vec_full_reg_offset(s, rn),
-            vec_full_reg_offset(s, rm),
-            vec_full_reg_offset(s, ra), vsz, vsz);
+    if (gvec_fn == NULL) {
+        return false;
+    }
+    if (sve_access_check(s)) {
+        unsigned vsz = vec_full_reg_size(s);
+        gvec_fn(a->esz, vec_full_reg_offset(s, a->rd),
+                vec_full_reg_offset(s, a->rn),
+                vec_full_reg_offset(s, a->rm),
+                vec_full_reg_offset(s, a->ra), vsz, vsz);
+    }
+    return true;
 }
 
 /* Invoke a vector move on two Zregs.  */
@@ -XXX,XX +XXX,XX @@ static bool do_sve2_zzzz_fn(DisasContext *s, arg_rrrr_esz *a, GVecGen4Fn *fn)
     if (!dc_isar_feature(aa64_sve2, s)) {
         return false;
     }
-    if (sve_access_check(s)) {
-        gen_gvec_fn_zzzz(s, fn, a->esz, a->rd, a->rn, a->rm, a->ra);
-    }
-    return true;
+    return gen_gvec_fn_arg_zzzz(s, fn, a);
 }
 
 static void gen_eor3_i64(TCGv_i64 d, TCGv_i64 n, TCGv_i64 m, TCGv_i64 k)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions using do_sve2_zzzz_fn
to use TRANS_FEAT and gen_gvec_fn_arg_zzzz.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-38-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 38 ++++++--------------------------------
 1 file changed, 6 insertions(+), 32 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_XAR(DisasContext *s, arg_rrri_esz *a)
     return true;
 }
 
-static bool do_sve2_zzzz_fn(DisasContext *s, arg_rrrr_esz *a, GVecGen4Fn *fn)
-{
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_fn_arg_zzzz(s, fn, a);
-}
-
 static void gen_eor3_i64(TCGv_i64 d, TCGv_i64 n, TCGv_i64 m, TCGv_i64 k)
 {
     tcg_gen_xor_i64(d, n, m);
@@ -XXX,XX +XXX,XX @@ static void gen_eor3(unsigned vece, uint32_t d, uint32_t n, uint32_t m,
     tcg_gen_gvec_4(d, n, m, a, oprsz, maxsz, &op);
 }
 
-static bool trans_EOR3(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_sve2_zzzz_fn(s, a, gen_eor3);
-}
+TRANS_FEAT(EOR3, aa64_sve2, gen_gvec_fn_arg_zzzz, gen_eor3, a)
 
 static void gen_bcax_i64(TCGv_i64 d, TCGv_i64 n, TCGv_i64 m, TCGv_i64 k)
 {
@@ -XXX,XX +XXX,XX @@ static void gen_bcax(unsigned vece, uint32_t d, uint32_t n, uint32_t m,
     tcg_gen_gvec_4(d, n, m, a, oprsz, maxsz, &op);
 }
 
-static bool trans_BCAX(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_sve2_zzzz_fn(s, a, gen_bcax);
-}
+TRANS_FEAT(BCAX, aa64_sve2, gen_gvec_fn_arg_zzzz, gen_bcax, a)
 
 static void gen_bsl(unsigned vece, uint32_t d, uint32_t n, uint32_t m,
                     uint32_t a, uint32_t oprsz, uint32_t maxsz)
@@ -XXX,XX +XXX,XX @@ static void gen_bsl(unsigned vece, uint32_t d, uint32_t n, uint32_t m,
     tcg_gen_gvec_bitsel(vece, d, a, n, m, oprsz, maxsz);
 }
 
-static bool trans_BSL(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_sve2_zzzz_fn(s, a, gen_bsl);
-}
+TRANS_FEAT(BSL, aa64_sve2, gen_gvec_fn_arg_zzzz, gen_bsl, a)
 
 static void gen_bsl1n_i64(TCGv_i64 d, TCGv_i64 n, TCGv_i64 m, TCGv_i64 k)
 {
@@ -XXX,XX +XXX,XX @@ static void gen_bsl1n(unsigned vece, uint32_t d, uint32_t n, uint32_t m,
     tcg_gen_gvec_4(d, n, m, a, oprsz, maxsz, &op);
 }
 
-static bool trans_BSL1N(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_sve2_zzzz_fn(s, a, gen_bsl1n);
-}
+TRANS_FEAT(BSL1N, aa64_sve2, gen_gvec_fn_arg_zzzz, gen_bsl1n, a)
 
 static void gen_bsl2n_i64(TCGv_i64 d, TCGv_i64 n, TCGv_i64 m, TCGv_i64 k)
 {
@@ -XXX,XX +XXX,XX @@ static void gen_bsl2n(unsigned vece, uint32_t d, uint32_t n, uint32_t m,
     tcg_gen_gvec_4(d, n, m, a, oprsz, maxsz, &op);
 }
 
-static bool trans_BSL2N(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_sve2_zzzz_fn(s, a, gen_bsl2n);
-}
+TRANS_FEAT(BSL2N, aa64_sve2, gen_gvec_fn_arg_zzzz, gen_bsl2n, a)
 
 static void gen_nbsl_i64(TCGv_i64 d, TCGv_i64 n, TCGv_i64 m, TCGv_i64 k)
 {
@@ -XXX,XX +XXX,XX @@ static void gen_nbsl(unsigned vece, uint32_t d, uint32_t n, uint32_t m,
     tcg_gen_gvec_4(d, n, m, a, oprsz, maxsz, &op);
 }
 
-static bool trans_NBSL(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_sve2_zzzz_fn(s, a, gen_nbsl);
-}
+TRANS_FEAT(NBSL, aa64_sve2, gen_gvec_fn_arg_zzzz, gen_nbsl, a)
 
 /*
  *** SVE Integer Arithmetic - Unpredicated Group
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

We have two places that perform this particular operation.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-39-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 30 +++++++++++++++++-------------
 1 file changed, 17 insertions(+), 13 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-40-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 17 +++--------------
 1 file changed, 3 insertions(+), 14 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

The check is already done in gen_gvec_ool_zzzp,
which is called by do_sel_z; remove from callers.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-41-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 14 ++++----------
 1 file changed, 4 insertions(+), 10 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(UQSUB_zzz, aa64_sve, gen_gvec_fn_arg_zzz, tcg_gen_gvec_ussub, a)
 /* Select active elememnts from Zn and inactive elements from Zm,
  * storing the result in Zd.
  */
-static void do_sel_z(DisasContext *s, int rd, int rn, int rm, int pg, int esz)
+static bool do_sel_z(DisasContext *s, int rd, int rn, int rm, int pg, int esz)
 {
     static gen_helper_gvec_4 * const fns[4] = {
         gen_helper_sve_sel_zpzz_b, gen_helper_sve_sel_zpzz_h,
         gen_helper_sve_sel_zpzz_s, gen_helper_sve_sel_zpzz_d
     };
-    gen_gvec_ool_zzzp(s, fns[esz], rd, rn, rm, pg, 0);
+    return gen_gvec_ool_zzzp(s, fns[esz], rd, rn, rm, pg, 0);
 }
 
 #define DO_ZPZZ(NAME, FEAT, name) \
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(UDIV_zpzz, aa64_sve, gen_gvec_ool_arg_zpzz, udiv_fns[a->esz], a, 0)
 
 static bool trans_SEL_zpzz(DisasContext *s, arg_rprr_esz *a)
 {
-    if (sve_access_check(s)) {
-        do_sel_z(s, a->rd, a->rn, a->rm, a->pg, a->esz);
-    }
-    return true;
+    return do_sel_z(s, a->rd, a->rn, a->rm, a->pg, a->esz);
 }
 
 /*
@@ -XXX,XX +XXX,XX @@ static bool trans_MOVPRFX(DisasContext *s, arg_MOVPRFX *a)
 
 static bool trans_MOVPRFX_m(DisasContext *s, arg_rpr_esz *a)
 {
-    if (sve_access_check(s)) {
-        do_sel_z(s, a->rd, a->rn, a->rd, a->pg, a->esz);
-    }
-    return true;
+    return do_sel_z(s, a->rd, a->rn, a->rd, a->pg, a->esz);
 }
 
 static bool trans_MOVPRFX_z(DisasContext *s, arg_rpr_esz *a)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

We have two places that perform this particular operation.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-42-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 21 +++++++++++++--------
 1 file changed, 13 insertions(+), 8 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions using do_sve2_fn2i
to use TRANS_FEAT and gen_gvec_fn_arg_zzi.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-43-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 43 ++++++--------------------------------
 1 file changed, 6 insertions(+), 37 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_adcl(DisasContext *s, arg_rrrr_esz *a, bool sel)
 TRANS_FEAT(ADCLB, aa64_sve2, do_adcl, a, false)
 TRANS_FEAT(ADCLT, aa64_sve2, do_adcl, a, true)
 
-static bool do_sve2_fn2i(DisasContext *s, arg_rri_esz *a, GVecGen2iFn *fn)
-{
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_fn_arg_zzi(s, fn, a);
-}
-
-static bool trans_SSRA(DisasContext *s, arg_rri_esz *a)
-{
-    return do_sve2_fn2i(s, a, gen_gvec_ssra);
-}
-
-static bool trans_USRA(DisasContext *s, arg_rri_esz *a)
-{
-    return do_sve2_fn2i(s, a, gen_gvec_usra);
-}
-
-static bool trans_SRSRA(DisasContext *s, arg_rri_esz *a)
-{
-    return do_sve2_fn2i(s, a, gen_gvec_srsra);
-}
-
-static bool trans_URSRA(DisasContext *s, arg_rri_esz *a)
-{
-    return do_sve2_fn2i(s, a, gen_gvec_ursra);
-}
-
-static bool trans_SRI(DisasContext *s, arg_rri_esz *a)
-{
-    return do_sve2_fn2i(s, a, gen_gvec_sri);
-}
-
-static bool trans_SLI(DisasContext *s, arg_rri_esz *a)
-{
-    return do_sve2_fn2i(s, a, gen_gvec_sli);
-}
+TRANS_FEAT(SSRA, aa64_sve2, gen_gvec_fn_arg_zzi, gen_gvec_ssra, a)
+TRANS_FEAT(USRA, aa64_sve2, gen_gvec_fn_arg_zzi, gen_gvec_usra, a)
+TRANS_FEAT(SRSRA, aa64_sve2, gen_gvec_fn_arg_zzi, gen_gvec_srsra, a)
+TRANS_FEAT(URSRA, aa64_sve2, gen_gvec_fn_arg_zzi, gen_gvec_ursra, a)
+TRANS_FEAT(SRI, aa64_sve2, gen_gvec_fn_arg_zzi, gen_gvec_sri, a)
+TRANS_FEAT(SLI, aa64_sve2, gen_gvec_fn_arg_zzi, gen_gvec_sli, a)
 
 TRANS_FEAT(SABA, aa64_sve2, gen_gvec_fn_arg_zzz, gen_gvec_saba, a)
 TRANS_FEAT(UABA, aa64_sve2, gen_gvec_fn_arg_zzz, gen_gvec_uaba, a)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-44-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 20 +++++++-------------
 1 file changed, 7 insertions(+), 13 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_vpz_ool(DisasContext *s, arg_rpr_esz *a,
 }
 
 #define DO_VPZ(NAME, name) \
-static bool trans_##NAME(DisasContext *s, arg_rpr_esz *a)                \
-{                                                                        \
-    static gen_helper_gvec_reduc * const fns[4] = {                      \
+    static gen_helper_gvec_reduc * const name##_fns[4] = {               \
         gen_helper_sve_##name##_b, gen_helper_sve_##name##_h,            \
         gen_helper_sve_##name##_s, gen_helper_sve_##name##_d,            \
     };                                                                   \
-    return do_vpz_ool(s, a, fns[a->esz]);                                \
-}
+    TRANS_FEAT(NAME, aa64_sve, do_vpz_ool, a, name##_fns[a->esz])
 
 DO_VPZ(ORV, orv)
 DO_VPZ(ANDV, andv)
@@ -XXX,XX +XXX,XX @@ DO_VPZ(UMAXV, umaxv)
 DO_VPZ(SMINV, sminv)
 DO_VPZ(UMINV, uminv)
 
-static bool trans_SADDV(DisasContext *s, arg_rpr_esz *a)
-{
-    static gen_helper_gvec_reduc * const fns[4] = {
-        gen_helper_sve_saddv_b, gen_helper_sve_saddv_h,
-        gen_helper_sve_saddv_s, NULL
-    };
-    return do_vpz_ool(s, a, fns[a->esz]);
-}
+static gen_helper_gvec_reduc * const saddv_fns[4] = {
+    gen_helper_sve_saddv_b, gen_helper_sve_saddv_h,
+    gen_helper_sve_saddv_s, NULL
+};
+TRANS_FEAT(SADDV, aa64_sve, do_vpz_ool, a, saddv_fns[a->esz])
 
 #undef DO_VPZ
 
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-45-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 17 +++--------------
 1 file changed, 3 insertions(+), 14 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_shift_imm(DisasContext *s, arg_rri_esz *a, bool asr,
     return true;
 }
 
-static bool trans_ASR_zzi(DisasContext *s, arg_rri_esz *a)
-{
-    return do_shift_imm(s, a, true, tcg_gen_gvec_sari);
-}
-
-static bool trans_LSR_zzi(DisasContext *s, arg_rri_esz *a)
-{
-    return do_shift_imm(s, a, false, tcg_gen_gvec_shri);
-}
-
-static bool trans_LSL_zzi(DisasContext *s, arg_rri_esz *a)
-{
-    return do_shift_imm(s, a, false, tcg_gen_gvec_shli);
-}
+TRANS_FEAT(ASR_zzi, aa64_sve, do_shift_imm, a, true, tcg_gen_gvec_sari)
+TRANS_FEAT(LSR_zzi, aa64_sve, do_shift_imm, a, false, tcg_gen_gvec_shri)
+TRANS_FEAT(LSL_zzi, aa64_sve, do_shift_imm, a, false, tcg_gen_gvec_shli)
 
 #define DO_ZZW(NAME, name) \
     static gen_helper_gvec_3 * const name##_zzw_fns[4] = {                \
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Share code between the various shifts using arg_rpri_esz.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-46-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 68 +++++++++++++++++---------------------
 1 file changed, 30 insertions(+), 38 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-47-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 52 +++++++++++++++-----------------------
 1 file changed, 20 insertions(+), 32 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Remove the DO_ZPZZZ macro, as it had just the two uses.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-48-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 23 ++++++++++-------------
 1 file changed, 10 insertions(+), 13 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_zpzzz_ool(DisasContext *s, arg_rprrr_esz *a,
     return true;
 }
 
-#define DO_ZPZZZ(NAME, name) \
-static bool trans_##NAME(DisasContext *s, arg_rprrr_esz *a)          \
-{                                                                    \
-    static gen_helper_gvec_5 * const fns[4] = {                      \
-        gen_helper_sve_##name##_b, gen_helper_sve_##name##_h,        \
-        gen_helper_sve_##name##_s, gen_helper_sve_##name##_d,        \
-    };                                                               \
-    return do_zpzzz_ool(s, a, fns[a->esz]);                          \
-}
+static gen_helper_gvec_5 * const mla_fns[4] = {
+    gen_helper_sve_mla_b, gen_helper_sve_mla_h,
+    gen_helper_sve_mla_s, gen_helper_sve_mla_d,
+};
+TRANS_FEAT(MLA, aa64_sve, do_zpzzz_ool, a, mla_fns[a->esz])
 
-DO_ZPZZZ(MLA, mla)
-DO_ZPZZZ(MLS, mls)
-
-#undef DO_ZPZZZ
+static gen_helper_gvec_5 * const mls_fns[4] = {
+    gen_helper_sve_mls_b, gen_helper_sve_mls_h,
+    gen_helper_sve_mls_s, gen_helper_sve_mls_d,
+};
+TRANS_FEAT(MLS, aa64_sve, do_zpzzz_ool, a, mls_fns[a->esz])
 
 /*
  *** SVE Index Generation Group
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-49-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 53 ++++++++++++++++++--------------------
 1 file changed, 25 insertions(+), 28 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(MLS, aa64_sve, do_zpzzz_ool, a, mls_fns[a->esz])
  *** SVE Index Generation Group
  */
 
-static void do_index(DisasContext *s, int esz, int rd,
+static bool do_index(DisasContext *s, int esz, int rd,
                      TCGv_i64 start, TCGv_i64 incr)
 {
-    unsigned vsz = vec_full_reg_size(s);
-    TCGv_i32 desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
-    TCGv_ptr t_zd = tcg_temp_new_ptr();
+    unsigned vsz;
+    TCGv_i32 desc;
+    TCGv_ptr t_zd;
+
+    if (!sve_access_check(s)) {
+        return true;
+    }
+
+    vsz = vec_full_reg_size(s);
+    desc = tcg_constant_i32(simd_desc(vsz, vsz, 0));
+    t_zd = tcg_temp_new_ptr();
 
     tcg_gen_addi_ptr(t_zd, cpu_env, vec_full_reg_offset(s, rd));
     if (esz == 3) {
@@ -XXX,XX +XXX,XX @@ static void do_index(DisasContext *s, int esz, int rd,
         tcg_temp_free_i32(i32);
     }
     tcg_temp_free_ptr(t_zd);
+    return true;
 }
 
 static bool trans_INDEX_ii(DisasContext *s, arg_INDEX_ii *a)
 {
-    if (sve_access_check(s)) {
-        TCGv_i64 start = tcg_constant_i64(a->imm1);
-        TCGv_i64 incr = tcg_constant_i64(a->imm2);
-        do_index(s, a->esz, a->rd, start, incr);
-    }
-    return true;
+    TCGv_i64 start = tcg_constant_i64(a->imm1);
+    TCGv_i64 incr = tcg_constant_i64(a->imm2);
+    return do_index(s, a->esz, a->rd, start, incr);
 }
 
 static bool trans_INDEX_ir(DisasContext *s, arg_INDEX_ir *a)
 {
-    if (sve_access_check(s)) {
-        TCGv_i64 start = tcg_constant_i64(a->imm);
-        TCGv_i64 incr = cpu_reg(s, a->rm);
-        do_index(s, a->esz, a->rd, start, incr);
-    }
-    return true;
+    TCGv_i64 start = tcg_constant_i64(a->imm);
+    TCGv_i64 incr = cpu_reg(s, a->rm);
+    return do_index(s, a->esz, a->rd, start, incr);
 }
 
 static bool trans_INDEX_ri(DisasContext *s, arg_INDEX_ri *a)
 {
-    if (sve_access_check(s)) {
-        TCGv_i64 start = cpu_reg(s, a->rn);
-        TCGv_i64 incr = tcg_constant_i64(a->imm);
-        do_index(s, a->esz, a->rd, start, incr);
-    }
-    return true;
+    TCGv_i64 start = cpu_reg(s, a->rn);
+    TCGv_i64 incr = tcg_constant_i64(a->imm);
+    return do_index(s, a->esz, a->rd, start, incr);
 }
 
 static bool trans_INDEX_rr(DisasContext *s, arg_INDEX_rr *a)
 {
-    if (sve_access_check(s)) {
-        TCGv_i64 start = cpu_reg(s, a->rn);
-        TCGv_i64 incr = cpu_reg(s, a->rm);
-        do_index(s, a->esz, a->rd, start, incr);
-    }
-    return true;
+    TCGv_i64 start = cpu_reg(s, a->rn);
+    TCGv_i64 incr = cpu_reg(s, a->rm);
+    return do_index(s, a->esz, a->rd, start, incr);
 }
 
 /*
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-50-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 35 ++++++++---------------------------
 1 file changed, 8 insertions(+), 27 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_index(DisasContext *s, int esz, int rd,
     return true;
 }
 
-static bool trans_INDEX_ii(DisasContext *s, arg_INDEX_ii *a)
-{
-    TCGv_i64 start = tcg_constant_i64(a->imm1);
-    TCGv_i64 incr = tcg_constant_i64(a->imm2);
-    return do_index(s, a->esz, a->rd, start, incr);
-}
-
-static bool trans_INDEX_ir(DisasContext *s, arg_INDEX_ir *a)
-{
-    TCGv_i64 start = tcg_constant_i64(a->imm);
-    TCGv_i64 incr = cpu_reg(s, a->rm);
-    return do_index(s, a->esz, a->rd, start, incr);
-}
-
-static bool trans_INDEX_ri(DisasContext *s, arg_INDEX_ri *a)
-{
-    TCGv_i64 start = cpu_reg(s, a->rn);
-    TCGv_i64 incr = tcg_constant_i64(a->imm);
-    return do_index(s, a->esz, a->rd, start, incr);
-}
-
-static bool trans_INDEX_rr(DisasContext *s, arg_INDEX_rr *a)
-{
-    TCGv_i64 start = cpu_reg(s, a->rn);
-    TCGv_i64 incr = cpu_reg(s, a->rm);
-    return do_index(s, a->esz, a->rd, start, incr);
-}
+TRANS_FEAT(INDEX_ii, aa64_sve, do_index, a->esz, a->rd,
+           tcg_constant_i64(a->imm1), tcg_constant_i64(a->imm2))
+TRANS_FEAT(INDEX_ir, aa64_sve, do_index, a->esz, a->rd,
+           tcg_constant_i64(a->imm), cpu_reg(s, a->rm))
+TRANS_FEAT(INDEX_ri, aa64_sve, do_index, a->esz, a->rd,
+           cpu_reg(s, a->rn), tcg_constant_i64(a->imm))
+TRANS_FEAT(INDEX_rr, aa64_sve, do_index, a->esz, a->rd,
+           cpu_reg(s, a->rn), cpu_reg(s, a->rm))
 
 /*
  *** SVE Stack Allocation Group
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-51-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 23 ++++-------------------
 1 file changed, 4 insertions(+), 19 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-52-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 19 +++++--------------
 1 file changed, 5 insertions(+), 14 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_predset(DisasContext *s, int esz, int rd, int pat, bool setflag)
     return true;
 }
 
-static bool trans_PTRUE(DisasContext *s, arg_PTRUE *a)
-{
-    return do_predset(s, a->esz, a->rd, a->pat, a->s);
-}
+TRANS_FEAT(PTRUE, aa64_sve, do_predset, a->esz, a->rd, a->pat, a->s)
 
-static bool trans_SETFFR(DisasContext *s, arg_SETFFR *a)
-{
-    /* Note pat == 31 is #all, to set all elements.  */
-    return do_predset(s, 0, FFR_PRED_NUM, 31, false);
-}
+/* Note pat == 31 is #all, to set all elements.  */
+TRANS_FEAT(SETFFR, aa64_sve, do_predset, 0, FFR_PRED_NUM, 31, false)
 
-static bool trans_PFALSE(DisasContext *s, arg_PFALSE *a)
-{
-    /* Note pat == 32 is #unimp, to set no elements.  */
-    return do_predset(s, 0, a->rd, 32, false);
-}
+/* Note pat == 32 is #unimp, to set no elements.  */
+TRANS_FEAT(PFALSE, aa64_sve, do_predset, 0, a->rd, 32, false)
 
 static bool trans_RDFFR_p(DisasContext *s, arg_RDFFR_p *a)
 {
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-53-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 11 ++---------
 1 file changed, 2 insertions(+), 9 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_RDFFR_p(DisasContext *s, arg_RDFFR_p *a)
     return trans_AND_pppp(s, &alt_a);
 }
 
-static bool trans_RDFFR(DisasContext *s, arg_RDFFR *a)
-{
-    return do_mov_p(s, a->rd, FFR_PRED_NUM);
-}
-
-static bool trans_WRFFR(DisasContext *s, arg_WRFFR *a)
-{
-    return do_mov_p(s, FFR_PRED_NUM, a->rn);
-}
+TRANS_FEAT(RDFFR, aa64_sve, do_mov_p, a->rd, FFR_PRED_NUM)
+TRANS_FEAT(WRFFR, aa64_sve, do_mov_p, FFR_PRED_NUM, a->rn)
 
 static bool do_pfirst_pnext(DisasContext *s, arg_rr_esz *a,
                             void (*gen_fn)(TCGv_i32, TCGv_ptr,
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-54-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 11 ++---------
 1 file changed, 2 insertions(+), 9 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_pfirst_pnext(DisasContext *s, arg_rr_esz *a,
     return true;
 }
 
-static bool trans_PFIRST(DisasContext *s, arg_rr_esz *a)
-{
-    return do_pfirst_pnext(s, a, gen_helper_sve_pfirst);
-}
-
-static bool trans_PNEXT(DisasContext *s, arg_rr_esz *a)
-{
-    return do_pfirst_pnext(s, a, gen_helper_sve_pnext);
-}
+TRANS_FEAT(PFIRST, aa64_sve, do_pfirst_pnext, a, gen_helper_sve_pfirst)
+TRANS_FEAT(PNEXT, aa64_sve, do_pfirst_pnext, a, gen_helper_sve_pnext)
 
 /*
  *** SVE Element Count Group
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-55-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 14 ++------------
 1 file changed, 2 insertions(+), 12 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_EXT(DisasContext *s, int rd, int rn, int rm, int imm)
     return true;
 }
 
-static bool trans_EXT(DisasContext *s, arg_EXT *a)
-{
-    return do_EXT(s, a->rd, a->rn, a->rm, a->imm);
-}
-
-static bool trans_EXT_sve2(DisasContext *s, arg_rri *a)
-{
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return do_EXT(s, a->rd, a->rn, (a->rn + 1) % 32, a->imm);
-}
+TRANS_FEAT(EXT, aa64_sve, do_EXT, a->rd, a->rn, a->rm, a->imm)
+TRANS_FEAT(EXT_sve2, aa64_sve2, do_EXT, a->rd, a->rn, (a->rn + 1) % 32, a->imm)
 
 /*
  *** SVE Permute - Unpredicated Group
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-56-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 35 ++++++-----------------------------
 1 file changed, 6 insertions(+), 29 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_perm_pred2(DisasContext *s, arg_rr_esz *a, bool high_odd,
     return true;
 }
 
-static bool trans_ZIP1_p(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_perm_pred3(s, a, 0, gen_helper_sve_zip_p);
-}
-
-static bool trans_ZIP2_p(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_perm_pred3(s, a, 1, gen_helper_sve_zip_p);
-}
-
-static bool trans_UZP1_p(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_perm_pred3(s, a, 0, gen_helper_sve_uzp_p);
-}
-
-static bool trans_UZP2_p(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_perm_pred3(s, a, 1, gen_helper_sve_uzp_p);
-}
-
-static bool trans_TRN1_p(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_perm_pred3(s, a, 0, gen_helper_sve_trn_p);
-}
-
-static bool trans_TRN2_p(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_perm_pred3(s, a, 1, gen_helper_sve_trn_p);
-}
+TRANS_FEAT(ZIP1_p, aa64_sve, do_perm_pred3, a, 0, gen_helper_sve_zip_p)
+TRANS_FEAT(ZIP2_p, aa64_sve, do_perm_pred3, a, 1, gen_helper_sve_zip_p)
+TRANS_FEAT(UZP1_p, aa64_sve, do_perm_pred3, a, 0, gen_helper_sve_uzp_p)
+TRANS_FEAT(UZP2_p, aa64_sve, do_perm_pred3, a, 1, gen_helper_sve_uzp_p)
+TRANS_FEAT(TRN1_p, aa64_sve, do_perm_pred3, a, 0, gen_helper_sve_trn_p)
+TRANS_FEAT(TRN2_p, aa64_sve, do_perm_pred3, a, 1, gen_helper_sve_trn_p)
 
 static bool trans_REV_p(DisasContext *s, arg_rr_esz *a)
 {
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-57-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 17 +++--------------
 1 file changed, 3 insertions(+), 14 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(UZP2_p, aa64_sve, do_perm_pred3, a, 1, gen_helper_sve_uzp_p)
 TRANS_FEAT(TRN1_p, aa64_sve, do_perm_pred3, a, 0, gen_helper_sve_trn_p)
 TRANS_FEAT(TRN2_p, aa64_sve, do_perm_pred3, a, 1, gen_helper_sve_trn_p)
 
-static bool trans_REV_p(DisasContext *s, arg_rr_esz *a)
-{
-    return do_perm_pred2(s, a, 0, gen_helper_sve_rev_p);
-}
-
-static bool trans_PUNPKLO(DisasContext *s, arg_PUNPKLO *a)
-{
-    return do_perm_pred2(s, a, 0, gen_helper_sve_punpk_p);
-}
-
-static bool trans_PUNPKHI(DisasContext *s, arg_PUNPKHI *a)
-{
-    return do_perm_pred2(s, a, 1, gen_helper_sve_punpk_p);
-}
+TRANS_FEAT(REV_p, aa64_sve, do_perm_pred2, a, 0, gen_helper_sve_rev_p)
+TRANS_FEAT(PUNPKLO, aa64_sve, do_perm_pred2, a, 0, gen_helper_sve_punpk_p)
+TRANS_FEAT(PUNPKHI, aa64_sve, do_perm_pred2, a, 1, gen_helper_sve_punpk_p)
 
 /*
  *** SVE Permute - Interleaving Group
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

This is in line with how we treat uzp, and will
eliminate the special case code during translation.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-58-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/sve_helper.c    |  6 ++++--
 target/arm/translate-sve.c | 12 ++++++------
 2 files changed, 10 insertions(+), 8 deletions(-)

diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve_helper.c
+++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(sve_punpk_p)(void *vd, void *vn, uint32_t pred_desc)
 void HELPER(NAME)(void *vd, void *vn, void *vm, uint32_t desc)       \
 {                                                                    \
     intptr_t oprsz = simd_oprsz(desc);                               \
+    intptr_t odd_ofs = simd_data(desc);                              \
     intptr_t i, oprsz_2 = oprsz / 2;                                 \
     ARMVectorReg tmp_n, tmp_m;                                       \
     /* We produce output faster than we consume input.               \
@@ -XXX,XX +XXX,XX @@ void HELPER(NAME)(void *vd, void *vn, void *vm, uint32_t desc)       \
         vm = memcpy(&tmp_m, vm, oprsz_2);                            \
     }                                                                \
     for (i = 0; i < oprsz_2; i += sizeof(TYPE)) {                    \
-        *(TYPE *)(vd + H(2 * i + 0)) = *(TYPE *)(vn + H(i));         \
-        *(TYPE *)(vd + H(2 * i + sizeof(TYPE))) = *(TYPE *)(vm + H(i)); \
+        *(TYPE *)(vd + H(2 * i + 0)) = *(TYPE *)(vn + odd_ofs + H(i)); \
+        *(TYPE *)(vd + H(2 * i + sizeof(TYPE))) =                    \
+            *(TYPE *)(vm + odd_ofs + H(i));                          \
     }                                                                \
     if (sizeof(TYPE) == 16 && unlikely(oprsz & 16)) {                \
         memset(vd + oprsz - 16, 0, 16);                              \
diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_zip(DisasContext *s, arg_rrr_esz *a, bool high)
         unsigned vsz = vec_full_reg_size(s);
         unsigned high_ofs = high ? vsz / 2 : 0;
         tcg_gen_gvec_3_ool(vec_full_reg_offset(s, a->rd),
-                           vec_full_reg_offset(s, a->rn) + high_ofs,
-                           vec_full_reg_offset(s, a->rm) + high_ofs,
-                           vsz, vsz, 0, fns[a->esz]);
+                           vec_full_reg_offset(s, a->rn),
+                           vec_full_reg_offset(s, a->rm),
+                           vsz, vsz, high_ofs, fns[a->esz]);
     }
     return true;
 }
@@ -XXX,XX +XXX,XX @@ static bool do_zip_q(DisasContext *s, arg_rrr_esz *a, bool high)
         unsigned vsz = vec_full_reg_size(s);
         unsigned high_ofs = high ? QEMU_ALIGN_DOWN(vsz, 32) / 2 : 0;
         tcg_gen_gvec_3_ool(vec_full_reg_offset(s, a->rd),
-                           vec_full_reg_offset(s, a->rn) + high_ofs,
-                           vec_full_reg_offset(s, a->rm) + high_ofs,
-                           vsz, vsz, 0, gen_helper_sve2_zip_q);
+                           vec_full_reg_offset(s, a->rn),
+                           vec_full_reg_offset(s, a->rm),
+                           vsz, vsz, high_ofs, gen_helper_sve2_zip_q);
     }
     return true;
 }
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-59-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 25 +++++++------------------
 1 file changed, 7 insertions(+), 18 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_zip(DisasContext *s, arg_rrr_esz *a, bool high)
         gen_helper_sve_zip_b, gen_helper_sve_zip_h,
         gen_helper_sve_zip_s, gen_helper_sve_zip_d,
     };
+    unsigned vsz = vec_full_reg_size(s);
+    unsigned high_ofs = high ? vsz / 2 : 0;
 
-    if (sve_access_check(s)) {
-        unsigned vsz = vec_full_reg_size(s);
-        unsigned high_ofs = high ? vsz / 2 : 0;
-        tcg_gen_gvec_3_ool(vec_full_reg_offset(s, a->rd),
-                           vec_full_reg_offset(s, a->rn),
-                           vec_full_reg_offset(s, a->rm),
-                           vsz, vsz, high_ofs, fns[a->esz]);
-    }
-    return true;
+    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, high_ofs);
 }
 
 static bool trans_ZIP1_z(DisasContext *s, arg_rrr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_ZIP2_z(DisasContext *s, arg_rrr_esz *a)
 
 static bool do_zip_q(DisasContext *s, arg_rrr_esz *a, bool high)
 {
+    unsigned vsz = vec_full_reg_size(s);
+    unsigned high_ofs = high ? QEMU_ALIGN_DOWN(vsz, 32) / 2 : 0;
+
     if (!dc_isar_feature(aa64_sve_f64mm, s)) {
         return false;
     }
-    if (sve_access_check(s)) {
-        unsigned vsz = vec_full_reg_size(s);
-        unsigned high_ofs = high ? QEMU_ALIGN_DOWN(vsz, 32) / 2 : 0;
-        tcg_gen_gvec_3_ool(vec_full_reg_offset(s, a->rd),
-                           vec_full_reg_offset(s, a->rn),
-                           vec_full_reg_offset(s, a->rm),
-                           vsz, vsz, high_ofs, gen_helper_sve2_zip_q);
-    }
-    return true;
+    return gen_gvec_ool_arg_zzz(s, gen_helper_sve2_zip_q, a, high_ofs);
 }
 
 static bool trans_ZIP1_q(DisasContext *s, arg_rrr_esz *a)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Convert SVE translation functions using do_zip*
to use TRANS_FEAT and gen_gvec_ool_arg_zzz.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-60-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 54 +++++++++-----------------------------
 1 file changed, 13 insertions(+), 41 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(PUNPKHI, aa64_sve, do_perm_pred2, a, 1, gen_helper_sve_punpk_p)
  *** SVE Permute - Interleaving Group
  */
 
-static bool do_zip(DisasContext *s, arg_rrr_esz *a, bool high)
-{
-    static gen_helper_gvec_3 * const fns[4] = {
-        gen_helper_sve_zip_b, gen_helper_sve_zip_h,
-        gen_helper_sve_zip_s, gen_helper_sve_zip_d,
-    };
-    unsigned vsz = vec_full_reg_size(s);
-    unsigned high_ofs = high ? vsz / 2 : 0;
+static gen_helper_gvec_3 * const zip_fns[4] = {
+    gen_helper_sve_zip_b, gen_helper_sve_zip_h,
+    gen_helper_sve_zip_s, gen_helper_sve_zip_d,
+};
+TRANS_FEAT(ZIP1_z, aa64_sve, gen_gvec_ool_arg_zzz,
+           zip_fns[a->esz], a, 0)
+TRANS_FEAT(ZIP2_z, aa64_sve, gen_gvec_ool_arg_zzz,
+           zip_fns[a->esz], a, vec_full_reg_size(s) / 2)
 
-    return gen_gvec_ool_arg_zzz(s, fns[a->esz], a, high_ofs);
-}
-
-static bool trans_ZIP1_z(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_zip(s, a, false);
-}
-
-static bool trans_ZIP2_z(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_zip(s, a, true);
-}
-
-static bool do_zip_q(DisasContext *s, arg_rrr_esz *a, bool high)
-{
-    unsigned vsz = vec_full_reg_size(s);
-    unsigned high_ofs = high ? QEMU_ALIGN_DOWN(vsz, 32) / 2 : 0;
-
-    if (!dc_isar_feature(aa64_sve_f64mm, s)) {
-        return false;
-    }
-    return gen_gvec_ool_arg_zzz(s, gen_helper_sve2_zip_q, a, high_ofs);
-}
-
-static bool trans_ZIP1_q(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_zip_q(s, a, false);
-}
-
-static bool trans_ZIP2_q(DisasContext *s, arg_rrr_esz *a)
-{
-    return do_zip_q(s, a, true);
-}
+TRANS_FEAT(ZIP1_q, aa64_sve_f64mm, gen_gvec_ool_arg_zzz,
+           gen_helper_sve2_zip_q, a, 0)
+TRANS_FEAT(ZIP2_q, aa64_sve_f64mm, gen_gvec_ool_arg_zzz,
+           gen_helper_sve2_zip_q, a,
+           QEMU_ALIGN_DOWN(vec_full_reg_size(s), 32) / 2)
 
 static gen_helper_gvec_3 * const uzp_fns[4] = {
     gen_helper_sve_uzp_b, gen_helper_sve_uzp_h,
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-61-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 11 ++---------
 1 file changed, 2 insertions(+), 9 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_clast_vector(DisasContext *s, arg_rprr_esz *a, bool before)
     return true;
 }
 
-static bool trans_CLASTA_z(DisasContext *s, arg_rprr_esz *a)
-{
-    return do_clast_vector(s, a, false);
-}
-
-static bool trans_CLASTB_z(DisasContext *s, arg_rprr_esz *a)
-{
-    return do_clast_vector(s, a, true);
-}
+TRANS_FEAT(CLASTA_z, aa64_sve, do_clast_vector, a, false)
+TRANS_FEAT(CLASTB_z, aa64_sve, do_clast_vector, a, true)
 
 /* Compute CLAST for a scalar.  */
 static void do_clast_scalar(DisasContext *s, int esz, int pg, int rm,
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-62-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 11 ++---------
 1 file changed, 2 insertions(+), 9 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_clast_fp(DisasContext *s, arg_rpr_esz *a, bool before)
     return true;
 }
 
-static bool trans_CLASTA_v(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_clast_fp(s, a, false);
-}
-
-static bool trans_CLASTB_v(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_clast_fp(s, a, true);
-}
+TRANS_FEAT(CLASTA_v, aa64_sve, do_clast_fp, a, false)
+TRANS_FEAT(CLASTB_v, aa64_sve, do_clast_fp, a, true)
 
 /* Compute CLAST for a Xreg.  */
 static bool do_clast_general(DisasContext *s, arg_rpr_esz *a, bool before)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-63-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 11 ++---------
 1 file changed, 2 insertions(+), 9 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_clast_general(DisasContext *s, arg_rpr_esz *a, bool before)
     return true;
 }
 
-static bool trans_CLASTA_r(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_clast_general(s, a, false);
-}
-
-static bool trans_CLASTB_r(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_clast_general(s, a, true);
-}
+TRANS_FEAT(CLASTA_r, aa64_sve, do_clast_general, a, false)
+TRANS_FEAT(CLASTB_r, aa64_sve, do_clast_general, a, true)
 
 /* Compute LAST for a scalar.  */
 static TCGv_i64 do_last_scalar(DisasContext *s, int esz,
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-64-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 11 ++---------
 1 file changed, 2 insertions(+), 9 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_last_fp(DisasContext *s, arg_rpr_esz *a, bool before)
     return true;
 }
 
-static bool trans_LASTA_v(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_last_fp(s, a, false);
-}
-
-static bool trans_LASTB_v(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_last_fp(s, a, true);
-}
+TRANS_FEAT(LASTA_v, aa64_sve, do_last_fp, a, false)
+TRANS_FEAT(LASTB_v, aa64_sve, do_last_fp, a, true)
 
 /* Compute LAST for a Xreg.  */
 static bool do_last_general(DisasContext *s, arg_rpr_esz *a, bool before)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-65-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 11 ++---------
 1 file changed, 2 insertions(+), 9 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_last_general(DisasContext *s, arg_rpr_esz *a, bool before)
     return true;
 }
 
-static bool trans_LASTA_r(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_last_general(s, a, false);
-}
-
-static bool trans_LASTB_r(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_last_general(s, a, true);
-}
+TRANS_FEAT(LASTA_r, aa64_sve, do_last_general, a, false)
+TRANS_FEAT(LASTB_r, aa64_sve, do_last_general, a, true)
 
 static bool trans_CPY_m_r(DisasContext *s, arg_rpr_esz *a)
 {
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-66-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 17 ++++-------------
 1 file changed, 4 insertions(+), 13 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(REVH, aa64_sve, gen_gvec_ool_arg_zpz, revh_fns[a->esz], a, 0)
 TRANS_FEAT(REVW, aa64_sve, gen_gvec_ool_arg_zpz,
            a->esz == 3 ? gen_helper_sve_revw_d : NULL, a, 0)
 
-static bool trans_SPLICE(DisasContext *s, arg_rprr_esz *a)
-{
-    return gen_gvec_ool_zzzp(s, gen_helper_sve_splice,
-                             a->rd, a->rn, a->rm, a->pg, a->esz);
-}
+TRANS_FEAT(SPLICE, aa64_sve, gen_gvec_ool_arg_zpzz,
+           gen_helper_sve_splice, a, a->esz)
 
-static bool trans_SPLICE_sve2(DisasContext *s, arg_rpr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return gen_gvec_ool_zzzp(s, gen_helper_sve_splice,
-                             a->rd, a->rn, (a->rn + 1) % 32, a->pg, a->esz);
-}
+TRANS_FEAT(SPLICE_sve2, aa64_sve2, gen_gvec_ool_zzzp, gen_helper_sve_splice,
+           a->rd, a->rn, (a->rn + 1) % 32, a->pg, a->esz)
 
 /*
  *** SVE Integer Compare - Vectors Group
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-67-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 28 ++++++++++++----------------
 1 file changed, 12 insertions(+), 16 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_ppzz_flags(DisasContext *s, arg_rprr_esz *a,
 }
 
 #define DO_PPZZ(NAME, name) \
-static bool trans_##NAME##_ppzz(DisasContext *s, arg_rprr_esz *a)         \
-{                                                                         \
-    static gen_helper_gvec_flags_4 * const fns[4] = {                     \
-        gen_helper_sve_##name##_ppzz_b, gen_helper_sve_##name##_ppzz_h,   \
-        gen_helper_sve_##name##_ppzz_s, gen_helper_sve_##name##_ppzz_d,   \
-    };                                                                    \
-    return do_ppzz_flags(s, a, fns[a->esz]);                              \
-}
+    static gen_helper_gvec_flags_4 * const name##_ppzz_fns[4] = {       \
+        gen_helper_sve_##name##_ppzz_b, gen_helper_sve_##name##_ppzz_h, \
+        gen_helper_sve_##name##_ppzz_s, gen_helper_sve_##name##_ppzz_d, \
+    };                                                                  \
+    TRANS_FEAT(NAME##_ppzz, aa64_sve, do_ppzz_flags,                    \
+               a, name##_ppzz_fns[a->esz])
 
 DO_PPZZ(CMPEQ, cmpeq)
 DO_PPZZ(CMPNE, cmpne)
@@ -XXX,XX +XXX,XX @@ DO_PPZZ(CMPHS, cmphs)
 #undef DO_PPZZ
 
 #define DO_PPZW(NAME, name) \
-static bool trans_##NAME##_ppzw(DisasContext *s, arg_rprr_esz *a)         \
-{                                                                         \
-    static gen_helper_gvec_flags_4 * const fns[4] = {                     \
-        gen_helper_sve_##name##_ppzw_b, gen_helper_sve_##name##_ppzw_h,   \
-        gen_helper_sve_##name##_ppzw_s, NULL                              \
-    };                                                                    \
-    return do_ppzz_flags(s, a, fns[a->esz]);                              \
-}
+    static gen_helper_gvec_flags_4 * const name##_ppzw_fns[4] = {       \
+        gen_helper_sve_##name##_ppzw_b, gen_helper_sve_##name##_ppzw_h, \
+        gen_helper_sve_##name##_ppzw_s, NULL                            \
+    };                                                                  \
+    TRANS_FEAT(NAME##_ppzw, aa64_sve, do_ppzz_flags,                    \
+               a, name##_ppzw_fns[a->esz])
 
 DO_PPZW(CMPEQ, cmpeq)
 DO_PPZW(CMPNE, cmpne)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-68-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 28 ++++++++--------------------
 1 file changed, 8 insertions(+), 20 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ DO_SVE2_ZZZ_NARROW(SUBHNT, subhnt)
 DO_SVE2_ZZZ_NARROW(RSUBHNB, rsubhnb)
 DO_SVE2_ZZZ_NARROW(RSUBHNT, rsubhnt)
 
-static bool do_sve2_ppzz_flags(DisasContext *s, arg_rprr_esz *a,
-                               gen_helper_gvec_flags_4 *fn)
-{
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return do_ppzz_flags(s, a, fn);
-}
+static gen_helper_gvec_flags_4 * const match_fns[4] = {
+    gen_helper_sve2_match_ppzz_b, gen_helper_sve2_match_ppzz_h, NULL, NULL
+};
+TRANS_FEAT(MATCH, aa64_sve2, do_ppzz_flags, a, match_fns[a->esz])
 
-#define DO_SVE2_PPZZ_MATCH(NAME, name)                                      \
-static bool trans_##NAME(DisasContext *s, arg_rprr_esz *a)                  \
-{                                                                           \
-    static gen_helper_gvec_flags_4 * const fns[4] = {                       \
-        gen_helper_sve2_##name##_ppzz_b, gen_helper_sve2_##name##_ppzz_h,   \
-        NULL,                            NULL                               \
-    };                                                                      \
-    return do_sve2_ppzz_flags(s, a, fns[a->esz]);                           \
-}
-
-DO_SVE2_PPZZ_MATCH(MATCH, match)
-DO_SVE2_PPZZ_MATCH(NMATCH, nmatch)
+static gen_helper_gvec_flags_4 * const nmatch_fns[4] = {
+    gen_helper_sve2_nmatch_ppzz_b, gen_helper_sve2_nmatch_ppzz_h, NULL, NULL
+};
+TRANS_FEAT(NMATCH, aa64_sve2, do_ppzz_flags, a, nmatch_fns[a->esz])
 
 static gen_helper_gvec_4 * const histcnt_fns[4] = {
     NULL, NULL, gen_helper_sve2_histcnt_s, gen_helper_sve2_histcnt_d
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-69-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 8 +++-----
 1 file changed, 3 insertions(+), 5 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_ppzi_flags(DisasContext *s, arg_rpri_esz *a,
 }
 
 #define DO_PPZI(NAME, name) \
-static bool trans_##NAME##_ppzi(DisasContext *s, arg_rpri_esz *a)         \
-{                                                                         \
-    static gen_helper_gvec_flags_3 * const fns[4] = {                     \
+    static gen_helper_gvec_flags_3 * const name##_ppzi_fns[4] = {         \
         gen_helper_sve_##name##_ppzi_b, gen_helper_sve_##name##_ppzi_h,   \
         gen_helper_sve_##name##_ppzi_s, gen_helper_sve_##name##_ppzi_d,   \
     };                                                                    \
-    return do_ppzi_flags(s, a, fns[a->esz]);                              \
-}
+    TRANS_FEAT(NAME##_ppzi, aa64_sve, do_ppzi_flags, a,                   \
+               name##_ppzi_fns[a->esz])
 
 DO_PPZI(CMPEQ, cmpeq)
 DO_PPZI(CMPNE, cmpne)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-70-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 45 ++++++++++++--------------------------
 1 file changed, 14 insertions(+), 31 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_brk2(DisasContext *s, arg_rpr_s *a,
     return true;
 }
 
-static bool trans_BRKPA(DisasContext *s, arg_rprr_s *a)
-{
-    return do_brk3(s, a, gen_helper_sve_brkpa, gen_helper_sve_brkpas);
-}
+TRANS_FEAT(BRKPA, aa64_sve, do_brk3, a,
+           gen_helper_sve_brkpa, gen_helper_sve_brkpas)
+TRANS_FEAT(BRKPB, aa64_sve, do_brk3, a,
+           gen_helper_sve_brkpb, gen_helper_sve_brkpbs)
 
-static bool trans_BRKPB(DisasContext *s, arg_rprr_s *a)
-{
-    return do_brk3(s, a, gen_helper_sve_brkpb, gen_helper_sve_brkpbs);
-}
+TRANS_FEAT(BRKA_m, aa64_sve, do_brk2, a,
+           gen_helper_sve_brka_m, gen_helper_sve_brkas_m)
+TRANS_FEAT(BRKB_m, aa64_sve, do_brk2, a,
+           gen_helper_sve_brkb_m, gen_helper_sve_brkbs_m)
 
-static bool trans_BRKA_m(DisasContext *s, arg_rpr_s *a)
-{
-    return do_brk2(s, a, gen_helper_sve_brka_m, gen_helper_sve_brkas_m);
-}
+TRANS_FEAT(BRKA_z, aa64_sve, do_brk2, a,
+           gen_helper_sve_brka_z, gen_helper_sve_brkas_z)
+TRANS_FEAT(BRKB_z, aa64_sve, do_brk2, a,
+           gen_helper_sve_brkb_z, gen_helper_sve_brkbs_z)
 
-static bool trans_BRKB_m(DisasContext *s, arg_rpr_s *a)
-{
-    return do_brk2(s, a, gen_helper_sve_brkb_m, gen_helper_sve_brkbs_m);
-}
-
-static bool trans_BRKA_z(DisasContext *s, arg_rpr_s *a)
-{
-    return do_brk2(s, a, gen_helper_sve_brka_z, gen_helper_sve_brkas_z);
-}
-
-static bool trans_BRKB_z(DisasContext *s, arg_rpr_s *a)
-{
-    return do_brk2(s, a, gen_helper_sve_brkb_z, gen_helper_sve_brkbs_z);
-}
-
-static bool trans_BRKN(DisasContext *s, arg_rpr_s *a)
-{
-    return do_brk2(s, a, gen_helper_sve_brkn, gen_helper_sve_brkns);
-}
+TRANS_FEAT(BRKN, aa64_sve, do_brk2, a,
+           gen_helper_sve_brkn, gen_helper_sve_brkns)
 
 /*
  *** SVE Predicate Count Group
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-71-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 10 +---------
 1 file changed, 1 insertion(+), 9 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_SUBR_zzi(DisasContext *s, arg_rri_esz *a)
     return true;
 }
 
-static bool trans_MUL_zzi(DisasContext *s, arg_rri_esz *a)
-{
-    if (sve_access_check(s)) {
-        unsigned vsz = vec_full_reg_size(s);
-        tcg_gen_gvec_muli(a->esz, vec_full_reg_offset(s, a->rd),
-                          vec_full_reg_offset(s, a->rn), a->imm, vsz, vsz);
-    }
-    return true;
-}
+TRANS_FEAT(MUL_zzi, aa64_sve, gen_gvec_fn_arg_zzi, tcg_gen_gvec_muli, a)
 
 static bool do_zzi_sat(DisasContext *s, arg_rri_esz *a, bool u, bool d)
 {
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Remove the unparsed extraction in trans_DUP_i,
which is intended to reject an 8-bit shift of
an 8-bit constant for 8-bit element.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-72-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/sve.decode      |  5 ++++-
 target/arm/translate-sve.c | 10 ++++++----
 2 files changed, 10 insertions(+), 5 deletions(-)

diff --git a/target/arm/sve.decode b/target/arm/sve.decode
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve.decode
+++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@ WHILE_ptr       00100101 esz:2 1 rm:5 001 100 rn:5 rw:1 rd:4
 FDUP            00100101 esz:2 111 00 1110 imm:8 rd:5
 
 # SVE broadcast integer immediate (unpredicated)
-DUP_i           00100101 esz:2 111 00 011 . ........ rd:5       imm=%sh8_i8s
+{
+  INVALID       00100101 00    111 00 011 1 -------- -----
+  DUP_i         00100101 esz:2 111 00 011 . ........ rd:5       imm=%sh8_i8s
+}
 
 # SVE integer add/subtract immediate (unpredicated)
 ADD_zzi         00100101 .. 100 000 11 . ........ .....         @rdn_sh_i8u
diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ const uint64_t pred_esz_masks[4] = {
     0x1111111111111111ull, 0x0101010101010101ull
 };
 
+static bool trans_INVALID(DisasContext *s, arg_INVALID *a)
+{
+    unallocated_encoding(s);
+    return true;
+}
+
 /*
  *** SVE Logical - Unpredicated Group
  */
@@ -XXX,XX +XXX,XX @@ static bool trans_FDUP(DisasContext *s, arg_FDUP *a)
 
 static bool trans_DUP_i(DisasContext *s, arg_DUP_i *a)
 {
-    if (a->esz == 0 && extract32(s->insn, 13, 1)) {
-        return false;
-    }
     if (sve_access_check(s)) {
         unsigned vsz = vec_full_reg_size(s);
         int dofs = vec_full_reg_offset(s, a->rd);
-
         tcg_gen_gvec_dup_imm(a->esz, dofs, vsz, vsz, a->imm);
     }
     return true;
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Remove the unparsed extractions in trans_ADD_zzi, trans_SUBR_zzi,
and do_zzi_sat which are intended to reject an 8-bit shift of an
8-bit constant for 8-bit element.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-73-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/sve.decode      | 35 ++++++++++++++++++++++++++++-------
 target/arm/translate-sve.c |  9 ---------
 2 files changed, 28 insertions(+), 16 deletions(-)

diff --git a/target/arm/sve.decode b/target/arm/sve.decode
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve.decode
+++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@ FDUP            00100101 esz:2 111 00 1110 imm:8 rd:5
 }
 
 # SVE integer add/subtract immediate (unpredicated)
-ADD_zzi         00100101 .. 100 000 11 . ........ .....         @rdn_sh_i8u
-SUB_zzi         00100101 .. 100 001 11 . ........ .....         @rdn_sh_i8u
-SUBR_zzi        00100101 .. 100 011 11 . ........ .....         @rdn_sh_i8u
-SQADD_zzi       00100101 .. 100 100 11 . ........ .....         @rdn_sh_i8u
-UQADD_zzi       00100101 .. 100 101 11 . ........ .....         @rdn_sh_i8u
-SQSUB_zzi       00100101 .. 100 110 11 . ........ .....         @rdn_sh_i8u
-UQSUB_zzi       00100101 .. 100 111 11 . ........ .....         @rdn_sh_i8u
+{
+  INVALID       00100101 00 100 000 11 1 -------- -----
+  ADD_zzi       00100101 .. 100 000 11 . ........ .....         @rdn_sh_i8u
+}
+{
+  INVALID       00100101 00 100 001 11 1 -------- -----
+  SUB_zzi       00100101 .. 100 001 11 . ........ .....         @rdn_sh_i8u
+}
+{
+  INVALID       00100101 00 100 011 11 1 -------- -----
+  SUBR_zzi      00100101 .. 100 011 11 . ........ .....         @rdn_sh_i8u
+}
+{
+  INVALID       00100101 00 100 100 11 1 -------- -----
+  SQADD_zzi     00100101 .. 100 100 11 . ........ .....         @rdn_sh_i8u
+}
+{
+  INVALID       00100101 00 100 101 11 1 -------- -----
+  UQADD_zzi     00100101 .. 100 101 11 . ........ .....         @rdn_sh_i8u
+}
+{
+  INVALID       00100101 00 100 110 11 1 -------- -----
+  SQSUB_zzi     00100101 .. 100 110 11 . ........ .....         @rdn_sh_i8u
+}
+{
+  INVALID       00100101 00 100 111 11 1 -------- -----
+  UQSUB_zzi     00100101 .. 100 111 11 . ........ .....         @rdn_sh_i8u
+}
 
 # SVE integer min/max immediate (unpredicated)
 SMAX_zzi        00100101 .. 101 000 110 ........ .....          @rdn_i8s
diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_DUP_i(DisasContext *s, arg_DUP_i *a)
 
 static bool trans_ADD_zzi(DisasContext *s, arg_rri_esz *a)
 {
-    if (a->esz == 0 && extract32(s->insn, 13, 1)) {
-        return false;
-    }
     return gen_gvec_fn_arg_zzi(s, tcg_gen_gvec_addi, a);
 }
 
@@ -XXX,XX +XXX,XX @@ static bool trans_SUBR_zzi(DisasContext *s, arg_rri_esz *a)
           .scalar_first = true }
     };
 
-    if (a->esz == 0 && extract32(s->insn, 13, 1)) {
-        return false;
-    }
     if (sve_access_check(s)) {
         unsigned vsz = vec_full_reg_size(s);
         tcg_gen_gvec_2s(vec_full_reg_offset(s, a->rd),
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(MUL_zzi, aa64_sve, gen_gvec_fn_arg_zzi, tcg_gen_gvec_muli, a)
 
 static bool do_zzi_sat(DisasContext *s, arg_rri_esz *a, bool u, bool d)
 {
-    if (a->esz == 0 && extract32(s->insn, 13, 1)) {
-        return false;
-    }
     if (sve_access_check(s)) {
         do_sat_addsub_vec(s, a->esz, a->rd, a->rn,
                           tcg_constant_i64(a->imm), u, d);
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Remove the unparsed extractions in trans_CPY_{m,z}_i which are intended
to reject an 8-bit shift of an 8-bit constant for 8-bit element.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-74-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/sve.decode      | 10 ++++++++--
 target/arm/translate-sve.c |  6 ------
 2 files changed, 8 insertions(+), 8 deletions(-)

diff --git a/target/arm/sve.decode b/target/arm/sve.decode
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve.decode
+++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@ DUPM            00000101 11 0000 dbm:13 rd:5
 FCPY            00000101 .. 01 .... 110 imm:8 .....             @rdn_pg4
 
 # SVE copy integer immediate (predicated)
-CPY_m_i         00000101 .. 01 .... 01 . ........ .....   @rdn_pg4 imm=%sh8_i8s
-CPY_z_i         00000101 .. 01 .... 00 . ........ .....   @rdn_pg4 imm=%sh8_i8s
+{
+  INVALID       00000101 00 01 ---- 01 1 -------- -----
+  CPY_m_i       00000101 .. 01 .... 01 . ........ .....   @rdn_pg4 imm=%sh8_i8s
+}
+{
+  INVALID       00000101 00 01 ---- 00 1 -------- -----
+  CPY_z_i       00000101 .. 01 .... 00 . ........ .....   @rdn_pg4 imm=%sh8_i8s
+}
 
 ### SVE Permute - Extract Group
 
diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_FCPY(DisasContext *s, arg_FCPY *a)
 
 static bool trans_CPY_m_i(DisasContext *s, arg_rpri_esz *a)
 {
-    if (a->esz == 0 && extract32(s->insn, 13, 1)) {
-        return false;
-    }
     if (sve_access_check(s)) {
         do_cpy_m(s, a->esz, a->rd, a->rn, a->pg, tcg_constant_i64(a->imm));
     }
@@ -XXX,XX +XXX,XX @@ static bool trans_CPY_z_i(DisasContext *s, arg_CPY_z_i *a)
         gen_helper_sve_cpy_z_s, gen_helper_sve_cpy_z_d,
     };
 
-    if (a->esz == 0 && extract32(s->insn, 13, 1)) {
-        return false;
-    }
     if (sve_access_check(s)) {
         unsigned vsz = vec_full_reg_size(s);
         tcg_gen_gvec_2i_ool(vec_full_reg_offset(s, a->rd),
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-76-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 23 ++++-------------------
 1 file changed, 4 insertions(+), 19 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_zzi_sat(DisasContext *s, arg_rri_esz *a, bool u, bool d)
     return true;
 }
 
-static bool trans_SQADD_zzi(DisasContext *s, arg_rri_esz *a)
-{
-    return do_zzi_sat(s, a, false, false);
-}
-
-static bool trans_UQADD_zzi(DisasContext *s, arg_rri_esz *a)
-{
-    return do_zzi_sat(s, a, true, false);
-}
-
-static bool trans_SQSUB_zzi(DisasContext *s, arg_rri_esz *a)
-{
-    return do_zzi_sat(s, a, false, true);
-}
-
-static bool trans_UQSUB_zzi(DisasContext *s, arg_rri_esz *a)
-{
-    return do_zzi_sat(s, a, true, true);
-}
+TRANS_FEAT(SQADD_zzi, aa64_sve, do_zzi_sat, a, false, false)
+TRANS_FEAT(UQADD_zzi, aa64_sve, do_zzi_sat, a, true, false)
+TRANS_FEAT(SQSUB_zzi, aa64_sve, do_zzi_sat, a, false, true)
+TRANS_FEAT(UQSUB_zzi, aa64_sve, do_zzi_sat, a, true, true)
 
 static bool do_zzi_ool(DisasContext *s, arg_rri_esz *a, gen_helper_gvec_2i *fn)
 {
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-77-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 7 ++-----
 1 file changed, 2 insertions(+), 5 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_zzi_ool(DisasContext *s, arg_rri_esz *a, gen_helper_gvec_2i *fn)
 }
 
 #define DO_ZZI(NAME, name) \
-static bool trans_##NAME##_zzi(DisasContext *s, arg_rri_esz *a)         \
-{                                                                       \
-    static gen_helper_gvec_2i * const fns[4] = {                        \
+    static gen_helper_gvec_2i * const name##i_fns[4] = {                \
         gen_helper_sve_##name##i_b, gen_helper_sve_##name##i_h,         \
         gen_helper_sve_##name##i_s, gen_helper_sve_##name##i_d,         \
     };                                                                  \
-    return do_zzi_ool(s, a, fns[a->esz]);                               \
-}
+    TRANS_FEAT(NAME##_zzi, aa64_sve, do_zzi_ool, a, name##i_fns[a->esz])
 
 DO_ZZI(SMAX, smax)
 DO_ZZI(UMAX, umax)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Use these for the several varieties of floating-point
multiply-add instructions.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-78-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 140 ++++++++++++++-----------------------
 1 file changed, 53 insertions(+), 87 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Being able to specify the feature predicate in TRANS_FEAT
makes it easier to split trans_FMMLA by element size,
which also happens to simplify the decode.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-79-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/sve.decode      |  7 +++----
 target/arm/translate-sve.c | 27 ++++-----------------------
 2 files changed, 7 insertions(+), 27 deletions(-)

diff --git a/target/arm/sve.decode b/target/arm/sve.decode
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve.decode
+++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@ SQRDCMLAH_zzzz  01000100 esz:2 0 rm:5 0011 rot:2 rn:5 rd:5  ra=%reg_movprfx
 USDOT_zzzz      01000100 .. 0 ..... 011 110 ..... .....  @rda_rn_rm
 
 ### SVE2 floating point matrix multiply accumulate
-{
-  BFMMLA        01100100 01 1 ..... 111 001 ..... .....  @rda_rn_rm_e0
-  FMMLA         01100100 .. 1 ..... 111 001 ..... .....  @rda_rn_rm
-}
+BFMMLA          01100100 01 1 ..... 111 001 ..... .....  @rda_rn_rm_e0
+FMMLA_s         01100100 10 1 ..... 111 001 ..... .....  @rda_rn_rm_e0
+FMMLA_d         01100100 11 1 ..... 111 001 ..... .....  @rda_rn_rm_e0
 
 ### SVE2 Memory Gather Load Group
 
diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ DO_SVE2_ZPZZ_FP(FMINP, fminp)
  * SVE Integer Multiply-Add (unpredicated)
  */
 
-static bool trans_FMMLA(DisasContext *s, arg_rrrr_esz *a)
-{
-    gen_helper_gvec_4_ptr *fn;
-
-    switch (a->esz) {
-    case MO_32:
-        if (!dc_isar_feature(aa64_sve_f32mm, s)) {
-            return false;
-        }
-        fn = gen_helper_fmmla_s;
-        break;
-    case MO_64:
-        if (!dc_isar_feature(aa64_sve_f64mm, s)) {
-            return false;
-        }
-        fn = gen_helper_fmmla_d;
-        break;
-    default:
-        return false;
-    }
-
-    return gen_gvec_fpst_zzzz(s, fn, a->rd, a->rn, a->rm, a->ra, 0, FPST_FPCR);
-}
+TRANS_FEAT(FMMLA_s, aa64_sve_f32mm, gen_gvec_fpst_zzzz, gen_helper_fmmla_s,
+           a->rd, a->rn, a->rm, a->ra, 0, FPST_FPCR)
+TRANS_FEAT(FMMLA_d, aa64_sve_f64mm, gen_gvec_fpst_zzzz, gen_helper_fmmla_d,
+           a->rd, a->rn, a->rm, a->ra, 0, FPST_FPCR)
 
 static gen_helper_gvec_4 * const sqdmlal_zzzw_fns[] = {
     NULL,                           gen_helper_sve2_sqdmlal_zzzw_h,
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Combined with the check already present in gen_mov_p,
we can simplify some special cases in trans_AND_pppp
and trans_BIC_pppp.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-80-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 30 ++++++++++++------------------
 1 file changed, 12 insertions(+), 18 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static void do_dupi_z(DisasContext *s, int rd, uint64_t word)
 }
 
 /* Invoke a vector expander on three Pregs.  */
-static void gen_gvec_fn_ppp(DisasContext *s, GVecGen3Fn *gvec_fn,
+static bool gen_gvec_fn_ppp(DisasContext *s, GVecGen3Fn *gvec_fn,
                             int rd, int rn, int rm)
 {
-    unsigned psz = pred_gvec_reg_size(s);
-    gvec_fn(MO_64, pred_full_reg_offset(s, rd),
-            pred_full_reg_offset(s, rn),
-            pred_full_reg_offset(s, rm), psz, psz);
+    if (sve_access_check(s)) {
+        unsigned psz = pred_gvec_reg_size(s);
+        gvec_fn(MO_64, pred_full_reg_offset(s, rd),
+                pred_full_reg_offset(s, rn),
+                pred_full_reg_offset(s, rm), psz, psz);
+    }
+    return true;
 }
 
 /* Invoke a vector move on two Pregs.  */
@@ -XXX,XX +XXX,XX @@ static bool trans_AND_pppp(DisasContext *s, arg_rprr_s *a)
     };
 
     if (!a->s) {
-        if (!sve_access_check(s)) {
-            return true;
-        }
         if (a->rn == a->rm) {
             if (a->pg == a->rn) {
-                do_mov_p(s, a->rd, a->rn);
-            } else {
-                gen_gvec_fn_ppp(s, tcg_gen_gvec_and, a->rd, a->rn, a->pg);
+                return do_mov_p(s, a->rd, a->rn);
             }
-            return true;
+            return gen_gvec_fn_ppp(s, tcg_gen_gvec_and, a->rd, a->rn, a->pg);
         } else if (a->pg == a->rn || a->pg == a->rm) {
-            gen_gvec_fn_ppp(s, tcg_gen_gvec_and, a->rd, a->rn, a->rm);
-            return true;
+            return gen_gvec_fn_ppp(s, tcg_gen_gvec_and, a->rd, a->rn, a->rm);
         }
     }
     return do_pppp_flags(s, a, &op);
@@ -XXX,XX +XXX,XX @@ static bool trans_BIC_pppp(DisasContext *s, arg_rprr_s *a)
     };
 
     if (!a->s && a->pg == a->rn) {
-        if (sve_access_check(s)) {
-            gen_gvec_fn_ppp(s, tcg_gen_gvec_andc, a->rd, a->rn, a->rm);
-        }
-        return true;
+        return gen_gvec_fn_ppp(s, tcg_gen_gvec_andc, a->rd, a->rn, a->rm);
     }
     return do_pppp_flags(s, a, &op);
 }
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

This alias is defined on EOR (prediates).  While the
same operation could be performed with NAND or NOR,
only bother with the official alias.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-81-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 5 +++++
 1 file changed, 5 insertions(+)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_EOR_pppp(DisasContext *s, arg_rprr_s *a)
         .fno = gen_helper_sve_eor_pppp,
         .prefer_i64 = TCG_TARGET_REG_BITS == 64,
     };
+
+    /* Alias NOT (predicate) is EOR Pd.B, Pg/Z, Pn.B, Pg.B */
+    if (!a->s && a->pg == a->rm) {
+        return gen_gvec_fn_ppp(s, tcg_gen_gvec_andc, a->rd, a->pg, a->rn);
+    }
     return do_pppp_flags(s, a, &op);
 }
 
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-83-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 17 +++--------------
 1 file changed, 3 insertions(+), 14 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_PRF_rr(DisasContext *s, arg_PRF_rr *a)
  * In the meantime, just emit the moves.
  */
 
-static bool trans_MOVPRFX(DisasContext *s, arg_MOVPRFX *a)
-{
-    return do_mov_z(s, a->rd, a->rn);
-}
-
-static bool trans_MOVPRFX_m(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_sel_z(s, a->rd, a->rn, a->rd, a->pg, a->esz);
-}
-
-static bool trans_MOVPRFX_z(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_movz_zpz(s, a->rd, a->rn, a->pg, a->esz, false);
-}
+TRANS_FEAT(MOVPRFX, aa64_sve, do_mov_z, a->rd, a->rn)
+TRANS_FEAT(MOVPRFX_m, aa64_sve, do_sel_z, a->rd, a->rn, a->rd, a->pg, a->esz)
+TRANS_FEAT(MOVPRFX_z, aa64_sve, do_movz_zpz, a->rd, a->rn, a->pg, a->esz, false)
 
 /*
  * SVE2 Integer Multiply - Unpredicated
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-84-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 11 ++---------
 1 file changed, 2 insertions(+), 9 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_FMLA_zzxz(DisasContext *s, arg_rrxr_esz *a, bool sub)
                               a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
 }
 
-static bool trans_FMLA_zzxz(DisasContext *s, arg_FMLA_zzxz *a)
-{
-    return do_FMLA_zzxz(s, a, false);
-}
-
-static bool trans_FMLS_zzxz(DisasContext *s, arg_FMLA_zzxz *a)
-{
-    return do_FMLA_zzxz(s, a, true);
-}
+TRANS_FEAT(FMLA_zzxz, aa64_sve, do_FMLA_zzxz, a, false)
+TRANS_FEAT(FMLS_zzxz, aa64_sve, do_FMLA_zzxz, a, true)
 
 /*
  *** SVE Floating Point Multiply Indexed Group
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-85-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 28 ++++------------------------
 1 file changed, 4 insertions(+), 24 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(BFMMLA, aa64_sve_bf16, gen_gvec_ool_arg_zzzz,
 
 static bool do_BFMLAL_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sel)
 {
-    if (!dc_isar_feature(aa64_sve_bf16, s)) {
-        return false;
-    }
     return gen_gvec_fpst_zzzz(s, gen_helper_gvec_bfmlal,
                               a->rd, a->rn, a->rm, a->ra, sel, FPST_FPCR);
 }
 
-static bool trans_BFMLALB_zzzw(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_BFMLAL_zzzw(s, a, false);
-}
-
-static bool trans_BFMLALT_zzzw(DisasContext *s, arg_rrrr_esz *a)
-{
-    return do_BFMLAL_zzzw(s, a, true);
-}
+TRANS_FEAT(BFMLALB_zzzw, aa64_sve_bf16, do_BFMLAL_zzzw, a, false)
+TRANS_FEAT(BFMLALT_zzzw, aa64_sve_bf16, do_BFMLAL_zzzw, a, true)
 
 static bool do_BFMLAL_zzxw(DisasContext *s, arg_rrxr_esz *a, bool sel)
 {
-    if (!dc_isar_feature(aa64_sve_bf16, s)) {
-        return false;
-    }
     return gen_gvec_fpst_zzzz(s, gen_helper_gvec_bfmlal_idx,
                               a->rd, a->rn, a->rm, a->ra,
                               (a->index << 1) | sel, FPST_FPCR);
 }
 
-static bool trans_BFMLALB_zzxw(DisasContext *s, arg_rrxr_esz *a)
-{
-    return do_BFMLAL_zzxw(s, a, false);
-}
-
-static bool trans_BFMLALT_zzxw(DisasContext *s, arg_rrxr_esz *a)
-{
-    return do_BFMLAL_zzxw(s, a, true);
-}
+TRANS_FEAT(BFMLALB_zzxw, aa64_sve_bf16, do_BFMLAL_zzxw, a, false)
+TRANS_FEAT(BFMLALT_zzxw, aa64_sve_bf16, do_BFMLAL_zzxw, a, true)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Rename the function to match gen_gvec_ool_arg_zzz,
and move to be adjacent.  Split out gen_gvec_fpst_zzz
as a helper while we're at it.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-86-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 50 +++++++++++++++++++++++---------------
 1 file changed, 30 insertions(+), 20 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-87-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 7 ++-----
 1 file changed, 2 insertions(+), 5 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_FADDA(DisasContext *s, arg_rprr_esz *a)
  */
 
 #define DO_FP3(NAME, name) \
-static bool trans_##NAME(DisasContext *s, arg_rrr_esz *a)           \
-{                                                                   \
-    static gen_helper_gvec_3_ptr * const fns[4] = {                 \
+    static gen_helper_gvec_3_ptr * const name##_fns[4] = {          \
         NULL, gen_helper_gvec_##name##_h,                           \
         gen_helper_gvec_##name##_s, gen_helper_gvec_##name##_d      \
     };                                                              \
-    return gen_gvec_fpst_arg_zzz(s, fns[a->esz], a, 0);             \
-}
+    TRANS_FEAT(NAME, aa64_sve, gen_gvec_fpst_arg_zzz, name##_fns[a->esz], a, 0)
 
 DO_FP3(FADD_zzz, fadd)
 DO_FP3(FSUB_zzz, fsub)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-88-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 26 +++++++-------------------
 1 file changed, 7 insertions(+), 19 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(FMLS_zzxz, aa64_sve, do_FMLA_zzxz, a, true)
  *** SVE Floating Point Multiply Indexed Group
  */
 
-static bool trans_FMUL_zzx(DisasContext *s, arg_FMUL_zzx *a)
-{
-    static gen_helper_gvec_3_ptr * const fns[3] = {
-        gen_helper_gvec_fmul_idx_h,
-        gen_helper_gvec_fmul_idx_s,
-        gen_helper_gvec_fmul_idx_d,
-    };
-
-    if (sve_access_check(s)) {
-        unsigned vsz = vec_full_reg_size(s);
-        TCGv_ptr status = fpstatus_ptr(a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
-        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, a->rd),
-                           vec_full_reg_offset(s, a->rn),
-                           vec_full_reg_offset(s, a->rm),
-                           status, vsz, vsz, a->index, fns[a->esz - 1]);
-        tcg_temp_free_ptr(status);
-    }
-    return true;
-}
+static gen_helper_gvec_3_ptr * const fmul_idx_fns[4] = {
+    NULL,                       gen_helper_gvec_fmul_idx_h,
+    gen_helper_gvec_fmul_idx_s, gen_helper_gvec_fmul_idx_d,
+};
+TRANS_FEAT(FMUL_zzx, aa64_sve, gen_gvec_fpst_zzz,
+           fmul_idx_fns[a->esz], a->rd, a->rn, a->rm, a->index,
+           a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR)
 
 /*
  *** SVE Floating Point Fast Reduction Group
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-89-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 29 +++++++----------------------
 1 file changed, 7 insertions(+), 22 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ DO_PPZ(FCMNE_ppz0, fcmne0)
  *** SVE floating-point trig multiply-add coefficient
  */
 
-static bool trans_FTMAD(DisasContext *s, arg_FTMAD *a)
-{
-    static gen_helper_gvec_3_ptr * const fns[3] = {
-        gen_helper_sve_ftmad_h,
-        gen_helper_sve_ftmad_s,
-        gen_helper_sve_ftmad_d,
-    };
-
-    if (a->esz == 0) {
-        return false;
-    }
-    if (sve_access_check(s)) {
-        unsigned vsz = vec_full_reg_size(s);
-        TCGv_ptr status = fpstatus_ptr(a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
-        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, a->rd),
-                           vec_full_reg_offset(s, a->rn),
-                           vec_full_reg_offset(s, a->rm),
-                           status, vsz, vsz, a->imm, fns[a->esz - 1]);
-        tcg_temp_free_ptr(status);
-    }
-    return true;
-}
+static gen_helper_gvec_3_ptr * const ftmad_fns[4] = {
+    NULL,                   gen_helper_sve_ftmad_h,
+    gen_helper_sve_ftmad_s, gen_helper_sve_ftmad_d,
+};
+TRANS_FEAT(FTMAD, aa64_sve, gen_gvec_fpst_zzz,
+           ftmad_fns[a->esz], a->rd, a->rn, a->rm, a->imm,
+           a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR)
 
 /*
  *** SVE Floating Point Accumulating Reduction Group
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-90-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 30 +++++++++++++++++-------------
 1 file changed, 17 insertions(+), 13 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(FMUL_zzx, aa64_sve, gen_gvec_fpst_zzz,
 typedef void gen_helper_fp_reduce(TCGv_i64, TCGv_ptr, TCGv_ptr,
                                   TCGv_ptr, TCGv_i32);
 
-static void do_reduce(DisasContext *s, arg_rpr_esz *a,
+static bool do_reduce(DisasContext *s, arg_rpr_esz *a,
                       gen_helper_fp_reduce *fn)
 {
-    unsigned vsz = vec_full_reg_size(s);
-    unsigned p2vsz = pow2ceil(vsz);
-    TCGv_i32 t_desc = tcg_constant_i32(simd_desc(vsz, vsz, p2vsz));
+    unsigned vsz, p2vsz;
+    TCGv_i32 t_desc;
     TCGv_ptr t_zn, t_pg, status;
     TCGv_i64 temp;
 
+    if (fn == NULL) {
+        return false;
+    }
+    if (!sve_access_check(s)) {
+        return true;
+    }
+
+    vsz = vec_full_reg_size(s);
+    p2vsz = pow2ceil(vsz);
+    t_desc = tcg_constant_i32(simd_desc(vsz, vsz, p2vsz));
     temp = tcg_temp_new_i64();
     t_zn = tcg_temp_new_ptr();
     t_pg = tcg_temp_new_ptr();
@@ -XXX,XX +XXX,XX @@ static void do_reduce(DisasContext *s, arg_rpr_esz *a,
 
     write_fp_dreg(s, a->rd, temp);
     tcg_temp_free_i64(temp);
+    return true;
 }
 
 #define DO_VPZ(NAME, name) \
 static bool trans_##NAME(DisasContext *s, arg_rpr_esz *a)                \
 {                                                                        \
-    static gen_helper_fp_reduce * const fns[3] = {                       \
-        gen_helper_sve_##name##_h,                                       \
+    static gen_helper_fp_reduce * const fns[4] = {                       \
+        NULL, gen_helper_sve_##name##_h,                                 \
         gen_helper_sve_##name##_s,                                       \
         gen_helper_sve_##name##_d,                                       \
     };                                                                   \
-    if (a->esz == 0) {                                                   \
-        return false;                                                    \
-    }                                                                    \
-    if (sve_access_check(s)) {                                           \
-        do_reduce(s, a, fns[a->esz - 1]);                                \
-    }                                                                    \
-    return true;                                                         \
+    return do_reduce(s, a, fns[a->esz]);                                 \
 }
 
 DO_VPZ(FADDV, faddv)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-91-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 14 ++++++--------
 1 file changed, 6 insertions(+), 8 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_reduce(DisasContext *s, arg_rpr_esz *a,
 }
 
 #define DO_VPZ(NAME, name) \
-static bool trans_##NAME(DisasContext *s, arg_rpr_esz *a)                \
-{                                                                        \
-    static gen_helper_fp_reduce * const fns[4] = {                       \
-        NULL, gen_helper_sve_##name##_h,                                 \
-        gen_helper_sve_##name##_s,                                       \
-        gen_helper_sve_##name##_d,                                       \
+    static gen_helper_fp_reduce * const name##_fns[4] = {                \
+        NULL,                      gen_helper_sve_##name##_h,            \
+        gen_helper_sve_##name##_s, gen_helper_sve_##name##_d,            \
     };                                                                   \
-    return do_reduce(s, a, fns[a->esz]);                                 \
-}
+    TRANS_FEAT(NAME, aa64_sve, do_reduce, a, name##_fns[a->esz])
 
 DO_VPZ(FADDV, faddv)
 DO_VPZ(FMINNMV, fminnmv)
@@ -XXX,XX +XXX,XX @@ DO_VPZ(FMAXNMV, fmaxnmv)
 DO_VPZ(FMINV, fminv)
 DO_VPZ(FMAXV, fmaxv)
 
+#undef DO_VPZ
+
 /*
  *** SVE Floating Point Unary Operations - Unpredicated Group
  */
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Rename do_zz_fp to gen_gvec_fpst_arg_zz, and move up.
Split out gen_gvec_fpst_zz as a helper while we're at it.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-92-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 77 ++++++++++++++++++--------------------
 1 file changed, 36 insertions(+), 41 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Simplify indexing of this array.  This will allow folding
of the illegal esz == 0 into the normal fn == NULL check.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-93-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 15 ++++++++-------
 1 file changed, 8 insertions(+), 7 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_FCVTZU_dd(DisasContext *s, arg_rpr_esz *a)
     return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzu_dd);
 }
 
-static gen_helper_gvec_3_ptr * const frint_fns[3] = {
+static gen_helper_gvec_3_ptr * const frint_fns[] = {
+    NULL,
     gen_helper_sve_frint_h,
     gen_helper_sve_frint_s,
     gen_helper_sve_frint_d
@@ -XXX,XX +XXX,XX @@ static bool trans_FRINTI(DisasContext *s, arg_rpr_esz *a)
         return false;
     }
     return do_zpz_ptr(s, a->rd, a->rn, a->pg, a->esz == MO_16,
-                      frint_fns[a->esz - 1]);
+                      frint_fns[a->esz]);
 }
 
 static bool trans_FRINTX(DisasContext *s, arg_rpr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_FRINTN(DisasContext *s, arg_rpr_esz *a)
     if (a->esz == 0) {
         return false;
     }
-    return do_frint_mode(s, a, float_round_nearest_even, frint_fns[a->esz - 1]);
+    return do_frint_mode(s, a, float_round_nearest_even, frint_fns[a->esz]);
 }
 
 static bool trans_FRINTP(DisasContext *s, arg_rpr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_FRINTP(DisasContext *s, arg_rpr_esz *a)
     if (a->esz == 0) {
         return false;
     }
-    return do_frint_mode(s, a, float_round_up, frint_fns[a->esz - 1]);
+    return do_frint_mode(s, a, float_round_up, frint_fns[a->esz]);
 }
 
 static bool trans_FRINTM(DisasContext *s, arg_rpr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_FRINTM(DisasContext *s, arg_rpr_esz *a)
     if (a->esz == 0) {
         return false;
     }
-    return do_frint_mode(s, a, float_round_down, frint_fns[a->esz - 1]);
+    return do_frint_mode(s, a, float_round_down, frint_fns[a->esz]);
 }
 
 static bool trans_FRINTZ(DisasContext *s, arg_rpr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_FRINTZ(DisasContext *s, arg_rpr_esz *a)
     if (a->esz == 0) {
         return false;
     }
-    return do_frint_mode(s, a, float_round_to_zero, frint_fns[a->esz - 1]);
+    return do_frint_mode(s, a, float_round_to_zero, frint_fns[a->esz]);
 }
 
 static bool trans_FRINTA(DisasContext *s, arg_rpr_esz *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_FRINTA(DisasContext *s, arg_rpr_esz *a)
     if (a->esz == 0) {
         return false;
     }
-    return do_frint_mode(s, a, float_round_ties_away, frint_fns[a->esz - 1]);
+    return do_frint_mode(s, a, float_round_ties_away, frint_fns[a->esz]);
 }
 
 static bool trans_FRECPX(DisasContext *s, arg_rpr_esz *a)
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Rename the function to match other expansion function and
move to be adjacent.  Split out gen_gvec_fpst_zzp as a
helper while we're at it.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-94-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 392 ++++++++++++-------------------------
 1 file changed, 129 insertions(+), 263 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool gen_gvec_ool_arg_zpzi(DisasContext *s, gen_helper_gvec_3 *fn,
     return gen_gvec_ool_zzp(s, fn, a->rd, a->rn, a->pg, a->imm);
 }
 
+static bool gen_gvec_fpst_zzp(DisasContext *s, gen_helper_gvec_3_ptr *fn,
+                              int rd, int rn, int pg, int data,
+                              ARMFPStatusFlavour flavour)
+{
+    if (fn == NULL) {
+        return false;
+    }
+    if (sve_access_check(s)) {
+        unsigned vsz = vec_full_reg_size(s);
+        TCGv_ptr status = fpstatus_ptr(flavour);
+
+        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, rd),
+                           vec_full_reg_offset(s, rn),
+                           pred_full_reg_offset(s, pg),
+                           status, vsz, vsz, data, fn);
+        tcg_temp_free_ptr(status);
+    }
+    return true;
+}
+
+static bool gen_gvec_fpst_arg_zpz(DisasContext *s, gen_helper_gvec_3_ptr *fn,
+                                  arg_rpr_esz *a, int data,
+                                  ARMFPStatusFlavour flavour)
+{
+    return gen_gvec_fpst_zzp(s, fn, a->rd, a->rn, a->pg, data, flavour);
+}
+
 /* Invoke an out-of-line helper on 3 Zregs and a predicate. */
 static bool gen_gvec_ool_zzzp(DisasContext *s, gen_helper_gvec_4 *fn,
                               int rd, int rn, int rm, int pg, int data)
@@ -XXX,XX +XXX,XX @@ static bool trans_FCMLA_zzxz(DisasContext *s, arg_FCMLA_zzxz *a)
  *** SVE Floating Point Unary Operations Predicated Group
  */
 
-static bool do_zpz_ptr(DisasContext *s, int rd, int rn, int pg,
-                       bool is_fp16, gen_helper_gvec_3_ptr *fn)
-{
-    if (sve_access_check(s)) {
-        unsigned vsz = vec_full_reg_size(s);
-        TCGv_ptr status = fpstatus_ptr(is_fp16 ? FPST_FPCR_F16 : FPST_FPCR);
-        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, rd),
-                           vec_full_reg_offset(s, rn),
-                           pred_full_reg_offset(s, pg),
-                           status, vsz, vsz, 0, fn);
-        tcg_temp_free_ptr(status);
-    }
-    return true;
-}
+TRANS_FEAT(FCVT_sh, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvt_sh, a, 0, FPST_FPCR)
+TRANS_FEAT(FCVT_hs, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvt_hs, a, 0, FPST_FPCR)
 
-static bool trans_FCVT_sh(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvt_sh);
-}
+TRANS_FEAT(BFCVT, aa64_sve_bf16, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_bfcvt, a, 0, FPST_FPCR)
 
-static bool trans_FCVT_hs(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvt_hs);
-}
+TRANS_FEAT(FCVT_dh, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvt_dh, a, 0, FPST_FPCR)
+TRANS_FEAT(FCVT_hd, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvt_hd, a, 0, FPST_FPCR)
+TRANS_FEAT(FCVT_ds, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvt_ds, a, 0, FPST_FPCR)
+TRANS_FEAT(FCVT_sd, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvt_sd, a, 0, FPST_FPCR)
 
-static bool trans_BFCVT(DisasContext *s, arg_rpr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve_bf16, s)) {
-        return false;
-    }
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_bfcvt);
-}
+TRANS_FEAT(FCVTZS_hh, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvtzs_hh, a, 0, FPST_FPCR_F16)
+TRANS_FEAT(FCVTZU_hh, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvtzu_hh, a, 0, FPST_FPCR_F16)
+TRANS_FEAT(FCVTZS_hs, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvtzs_hs, a, 0, FPST_FPCR_F16)
+TRANS_FEAT(FCVTZU_hs, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvtzu_hs, a, 0, FPST_FPCR_F16)
+TRANS_FEAT(FCVTZS_hd, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvtzs_hd, a, 0, FPST_FPCR_F16)
+TRANS_FEAT(FCVTZU_hd, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvtzu_hd, a, 0, FPST_FPCR_F16)
 
-static bool trans_FCVT_dh(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvt_dh);
-}
+TRANS_FEAT(FCVTZS_ss, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvtzs_ss, a, 0, FPST_FPCR)
+TRANS_FEAT(FCVTZU_ss, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvtzu_ss, a, 0, FPST_FPCR)
+TRANS_FEAT(FCVTZS_sd, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvtzs_sd, a, 0, FPST_FPCR)
+TRANS_FEAT(FCVTZU_sd, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvtzu_sd, a, 0, FPST_FPCR)
+TRANS_FEAT(FCVTZS_ds, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvtzs_ds, a, 0, FPST_FPCR)
+TRANS_FEAT(FCVTZU_ds, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvtzu_ds, a, 0, FPST_FPCR)
 
-static bool trans_FCVT_hd(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvt_hd);
-}
-
-static bool trans_FCVT_ds(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvt_ds);
-}
-
-static bool trans_FCVT_sd(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvt_sd);
-}
-
-static bool trans_FCVTZS_hh(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzs_hh);
-}
-
-static bool trans_FCVTZU_hh(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzu_hh);
-}
-
-static bool trans_FCVTZS_hs(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzs_hs);
-}
-
-static bool trans_FCVTZU_hs(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzu_hs);
-}
-
-static bool trans_FCVTZS_hd(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzs_hd);
-}
-
-static bool trans_FCVTZU_hd(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzu_hd);
-}
-
-static bool trans_FCVTZS_ss(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzs_ss);
-}
-
-static bool trans_FCVTZU_ss(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzu_ss);
-}
-
-static bool trans_FCVTZS_sd(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzs_sd);
-}
-
-static bool trans_FCVTZU_sd(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzu_sd);
-}
-
-static bool trans_FCVTZS_ds(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzs_ds);
-}
-
-static bool trans_FCVTZU_ds(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzu_ds);
-}
-
-static bool trans_FCVTZS_dd(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzs_dd);
-}
-
-static bool trans_FCVTZU_dd(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzu_dd);
-}
+TRANS_FEAT(FCVTZS_dd, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvtzs_dd, a, 0, FPST_FPCR)
+TRANS_FEAT(FCVTZU_dd, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_fcvtzu_dd, a, 0, FPST_FPCR)
 
 static gen_helper_gvec_3_ptr * const frint_fns[] = {
     NULL,
@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_3_ptr * const frint_fns[] = {
     gen_helper_sve_frint_s,
     gen_helper_sve_frint_d
 };
+TRANS_FEAT(FRINTI, aa64_sve, gen_gvec_fpst_arg_zpz, frint_fns[a->esz],
+           a, 0, a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR)
 
-static bool trans_FRINTI(DisasContext *s, arg_rpr_esz *a)
-{
-    if (a->esz == 0) {
-        return false;
-    }
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, a->esz == MO_16,
-                      frint_fns[a->esz]);
-}
-
-static bool trans_FRINTX(DisasContext *s, arg_rpr_esz *a)
-{
-    static gen_helper_gvec_3_ptr * const fns[3] = {
-        gen_helper_sve_frintx_h,
-        gen_helper_sve_frintx_s,
-        gen_helper_sve_frintx_d
-    };
-    if (a->esz == 0) {
-        return false;
-    }
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, a->esz == MO_16, fns[a->esz - 1]);
-}
+static gen_helper_gvec_3_ptr * const frintx_fns[] = {
+    NULL,
+    gen_helper_sve_frintx_h,
+    gen_helper_sve_frintx_s,
+    gen_helper_sve_frintx_d
+};
+TRANS_FEAT(FRINTX, aa64_sve, gen_gvec_fpst_arg_zpz, frintx_fns[a->esz],
+           a, 0, a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
 
 static bool do_frint_mode(DisasContext *s, arg_rpr_esz *a,
                           int mode, gen_helper_gvec_3_ptr *fn)
@@ -XXX,XX +XXX,XX @@ static bool trans_FRINTA(DisasContext *s, arg_rpr_esz *a)
     return do_frint_mode(s, a, float_round_ties_away, frint_fns[a->esz]);
 }
 
-static bool trans_FRECPX(DisasContext *s, arg_rpr_esz *a)
-{
-    static gen_helper_gvec_3_ptr * const fns[3] = {
-        gen_helper_sve_frecpx_h,
-        gen_helper_sve_frecpx_s,
-        gen_helper_sve_frecpx_d
-    };
-    if (a->esz == 0) {
-        return false;
-    }
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, a->esz == MO_16, fns[a->esz - 1]);
-}
+static gen_helper_gvec_3_ptr * const frecpx_fns[] = {
+    NULL,                    gen_helper_sve_frecpx_h,
+    gen_helper_sve_frecpx_s, gen_helper_sve_frecpx_d,
+};
+TRANS_FEAT(FRECPX, aa64_sve, gen_gvec_fpst_arg_zpz, frecpx_fns[a->esz],
+           a, 0, a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR)
 
-static bool trans_FSQRT(DisasContext *s, arg_rpr_esz *a)
-{
-    static gen_helper_gvec_3_ptr * const fns[3] = {
-        gen_helper_sve_fsqrt_h,
-        gen_helper_sve_fsqrt_s,
-        gen_helper_sve_fsqrt_d
-    };
-    if (a->esz == 0) {
-        return false;
-    }
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, a->esz == MO_16, fns[a->esz - 1]);
-}
+static gen_helper_gvec_3_ptr * const fsqrt_fns[] = {
+    NULL,                   gen_helper_sve_fsqrt_h,
+    gen_helper_sve_fsqrt_s, gen_helper_sve_fsqrt_d,
+};
+TRANS_FEAT(FSQRT, aa64_sve, gen_gvec_fpst_arg_zpz, fsqrt_fns[a->esz],
+           a, 0, a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR)
 
-static bool trans_SCVTF_hh(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_scvt_hh);
-}
+TRANS_FEAT(SCVTF_hh, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_scvt_hh, a, 0, FPST_FPCR_F16)
+TRANS_FEAT(SCVTF_sh, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_scvt_sh, a, 0, FPST_FPCR_F16)
+TRANS_FEAT(SCVTF_dh, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_scvt_dh, a, 0, FPST_FPCR_F16)
 
-static bool trans_SCVTF_sh(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_scvt_sh);
-}
+TRANS_FEAT(SCVTF_ss, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_scvt_ss, a, 0, FPST_FPCR)
+TRANS_FEAT(SCVTF_ds, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_scvt_ds, a, 0, FPST_FPCR)
 
-static bool trans_SCVTF_dh(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_scvt_dh);
-}
+TRANS_FEAT(SCVTF_sd, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_scvt_sd, a, 0, FPST_FPCR)
+TRANS_FEAT(SCVTF_dd, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_scvt_dd, a, 0, FPST_FPCR)
 
-static bool trans_SCVTF_ss(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_scvt_ss);
-}
+TRANS_FEAT(UCVTF_hh, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_ucvt_hh, a, 0, FPST_FPCR_F16)
+TRANS_FEAT(UCVTF_sh, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_ucvt_sh, a, 0, FPST_FPCR_F16)
+TRANS_FEAT(UCVTF_dh, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_ucvt_dh, a, 0, FPST_FPCR_F16)
 
-static bool trans_SCVTF_ds(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_scvt_ds);
-}
+TRANS_FEAT(UCVTF_ss, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_ucvt_ss, a, 0, FPST_FPCR)
+TRANS_FEAT(UCVTF_ds, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_ucvt_ds, a, 0, FPST_FPCR)
+TRANS_FEAT(UCVTF_sd, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_ucvt_sd, a, 0, FPST_FPCR)
 
-static bool trans_SCVTF_sd(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_scvt_sd);
-}
-
-static bool trans_SCVTF_dd(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_scvt_dd);
-}
-
-static bool trans_UCVTF_hh(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_ucvt_hh);
-}
-
-static bool trans_UCVTF_sh(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_ucvt_sh);
-}
-
-static bool trans_UCVTF_dh(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_ucvt_dh);
-}
-
-static bool trans_UCVTF_ss(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_ucvt_ss);
-}
-
-static bool trans_UCVTF_ds(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_ucvt_ds);
-}
-
-static bool trans_UCVTF_sd(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_ucvt_sd);
-}
-
-static bool trans_UCVTF_dd(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_ucvt_dd);
-}
+TRANS_FEAT(UCVTF_dd, aa64_sve, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_ucvt_dd, a, 0, FPST_FPCR)
 
 /*
  *** SVE Memory - 32-bit Gather and Unsized Contiguous Group
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(SM4EKEY, aa64_sve2_sm4, gen_gvec_ool_arg_zzz,
 
 TRANS_FEAT(RAX1, aa64_sve2_sha3, gen_gvec_fn_arg_zzz, gen_gvec_rax1, a)
 
-static bool trans_FCVTNT_sh(DisasContext *s, arg_rpr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve2_fcvtnt_sh);
-}
+TRANS_FEAT(FCVTNT_sh, aa64_sve2, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve2_fcvtnt_sh, a, 0, FPST_FPCR)
+TRANS_FEAT(FCVTNT_ds, aa64_sve2, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve2_fcvtnt_ds, a, 0, FPST_FPCR)
 
-static bool trans_BFCVTNT(DisasContext *s, arg_rpr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve_bf16, s)) {
-        return false;
-    }
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_bfcvtnt);
-}
+TRANS_FEAT(BFCVTNT, aa64_sve_bf16, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve_bfcvtnt, a, 0, FPST_FPCR)
 
-static bool trans_FCVTNT_ds(DisasContext *s, arg_rpr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve2_fcvtnt_ds);
-}
-
-static bool trans_FCVTLT_hs(DisasContext *s, arg_rpr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve2_fcvtlt_hs);
-}
-
-static bool trans_FCVTLT_sd(DisasContext *s, arg_rpr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve2_fcvtlt_sd);
-}
+TRANS_FEAT(FCVTLT_hs, aa64_sve2, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve2_fcvtlt_hs, a, 0, FPST_FPCR)
+TRANS_FEAT(FCVTLT_sd, aa64_sve2, gen_gvec_fpst_arg_zpz,
+           gen_helper_sve2_fcvtlt_sd, a, 0, FPST_FPCR)
 
 static bool trans_FCVTX_ds(DisasContext *s, arg_rpr_esz *a)
 {
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-95-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 52 +++++++++++++++++---------------------
 1 file changed, 23 insertions(+), 29 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(FRINTX, aa64_sve, gen_gvec_fpst_arg_zpz, frintx_fns[a->esz],
 static bool do_frint_mode(DisasContext *s, arg_rpr_esz *a,
                           int mode, gen_helper_gvec_3_ptr *fn)
 {
-    if (sve_access_check(s)) {
-        unsigned vsz = vec_full_reg_size(s);
-        TCGv_i32 tmode = tcg_const_i32(mode);
-        TCGv_ptr status = fpstatus_ptr(a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
+    unsigned vsz;
+    TCGv_i32 tmode;
+    TCGv_ptr status;
 
-        gen_helper_set_rmode(tmode, tmode, status);
-
-        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, a->rd),
-                           vec_full_reg_offset(s, a->rn),
-                           pred_full_reg_offset(s, a->pg),
-                           status, vsz, vsz, 0, fn);
-
-        gen_helper_set_rmode(tmode, tmode, status);
-        tcg_temp_free_i32(tmode);
-        tcg_temp_free_ptr(status);
+    if (fn == NULL) {
+        return false;
     }
+    if (!sve_access_check(s)) {
+        return true;
+    }
+
+    vsz = vec_full_reg_size(s);
+    tmode = tcg_const_i32(mode);
+    status = fpstatus_ptr(a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
+
+    gen_helper_set_rmode(tmode, tmode, status);
+
+    tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, a->rd),
+                       vec_full_reg_offset(s, a->rn),
+                       pred_full_reg_offset(s, a->pg),
+                       status, vsz, vsz, 0, fn);
+
+    gen_helper_set_rmode(tmode, tmode, status);
+    tcg_temp_free_i32(tmode);
+    tcg_temp_free_ptr(status);
     return true;
 }
 
 static bool trans_FRINTN(DisasContext *s, arg_rpr_esz *a)
 {
-    if (a->esz == 0) {
-        return false;
-    }
     return do_frint_mode(s, a, float_round_nearest_even, frint_fns[a->esz]);
 }
 
 static bool trans_FRINTP(DisasContext *s, arg_rpr_esz *a)
 {
-    if (a->esz == 0) {
-        return false;
-    }
     return do_frint_mode(s, a, float_round_up, frint_fns[a->esz]);
 }
 
 static bool trans_FRINTM(DisasContext *s, arg_rpr_esz *a)
 {
-    if (a->esz == 0) {
-        return false;
-    }
     return do_frint_mode(s, a, float_round_down, frint_fns[a->esz]);
 }
 
 static bool trans_FRINTZ(DisasContext *s, arg_rpr_esz *a)
 {
-    if (a->esz == 0) {
-        return false;
-    }
     return do_frint_mode(s, a, float_round_to_zero, frint_fns[a->esz]);
 }
 
 static bool trans_FRINTA(DisasContext *s, arg_rpr_esz *a)
 {
-    if (a->esz == 0) {
-        return false;
-    }
     return do_frint_mode(s, a, float_round_ties_away, frint_fns[a->esz]);
 }
 
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-96-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 53 ++++++++++----------------------------
 1 file changed, 14 insertions(+), 39 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_frint_mode(DisasContext *s, arg_rpr_esz *a,
     return true;
 }
 
-static bool trans_FRINTN(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_frint_mode(s, a, float_round_nearest_even, frint_fns[a->esz]);
-}
-
-static bool trans_FRINTP(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_frint_mode(s, a, float_round_up, frint_fns[a->esz]);
-}
-
-static bool trans_FRINTM(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_frint_mode(s, a, float_round_down, frint_fns[a->esz]);
-}
-
-static bool trans_FRINTZ(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_frint_mode(s, a, float_round_to_zero, frint_fns[a->esz]);
-}
-
-static bool trans_FRINTA(DisasContext *s, arg_rpr_esz *a)
-{
-    return do_frint_mode(s, a, float_round_ties_away, frint_fns[a->esz]);
-}
+TRANS_FEAT(FRINTN, aa64_sve, do_frint_mode, a,
+           float_round_nearest_even, frint_fns[a->esz])
+TRANS_FEAT(FRINTP, aa64_sve, do_frint_mode, a,
+           float_round_up, frint_fns[a->esz])
+TRANS_FEAT(FRINTM, aa64_sve, do_frint_mode, a,
+           float_round_down, frint_fns[a->esz])
+TRANS_FEAT(FRINTZ, aa64_sve, do_frint_mode, a,
+           float_round_to_zero, frint_fns[a->esz])
+TRANS_FEAT(FRINTA, aa64_sve, do_frint_mode, a,
+           float_round_ties_away, frint_fns[a->esz])
 
 static gen_helper_gvec_3_ptr * const frecpx_fns[] = {
     NULL,                    gen_helper_sve_frecpx_h,
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(FCVTLT_hs, aa64_sve2, gen_gvec_fpst_arg_zpz,
 TRANS_FEAT(FCVTLT_sd, aa64_sve2, gen_gvec_fpst_arg_zpz,
            gen_helper_sve2_fcvtlt_sd, a, 0, FPST_FPCR)
 
-static bool trans_FCVTX_ds(DisasContext *s, arg_rpr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return do_frint_mode(s, a, float_round_to_odd, gen_helper_sve_fcvt_ds);
-}
-
-static bool trans_FCVTXNT_ds(DisasContext *s, arg_rpr_esz *a)
-{
-    if (!dc_isar_feature(aa64_sve2, s)) {
-        return false;
-    }
-    return do_frint_mode(s, a, float_round_to_odd, gen_helper_sve2_fcvtnt_ds);
-}
+TRANS_FEAT(FCVTX_ds, aa64_sve2, do_frint_mode, a,
+           float_round_to_odd, gen_helper_sve_fcvt_ds)
+TRANS_FEAT(FCVTXNT_ds, aa64_sve2, do_frint_mode, a,
+           float_round_to_odd, gen_helper_sve2_fcvtnt_ds)
 
 static bool trans_FLOGB(DisasContext *s, arg_rpr_esz *a)
 {
-- 
2.25.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20220527181907.189259-97-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 29 ++++++-----------------------
 1 file changed, 6 insertions(+), 23 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ TRANS_FEAT(FCVTX_ds, aa64_sve2, do_frint_mode, a,
 TRANS_FEAT(FCVTXNT_ds, aa64_sve2, do_frint_mode, a,
            float_round_to_odd, gen_helper_sve2_fcvtnt_ds)
 
-static bool trans_FLOGB(DisasContext *s, arg_rpr_esz *a)
-{
-    static gen_helper_gvec_3_ptr * const fns[] = {
-        NULL,               gen_helper_flogb_h,
-        gen_helper_flogb_s, gen_helper_flogb_d
-    };
-
-    if (!dc_isar_feature(aa64_sve2, s) || fns[a->esz] == NULL) {
-        return false;
-    }
-    if (sve_access_check(s)) {
-        TCGv_ptr status =
-            fpstatus_ptr(a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR);
-        unsigned vsz = vec_full_reg_size(s);
-
-        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, a->rd),
-                           vec_full_reg_offset(s, a->rn),
-                           pred_full_reg_offset(s, a->pg),
-                           status, vsz, vsz, 0, fns[a->esz]);
-        tcg_temp_free_ptr(status);
-    }
-    return true;
-}
+static gen_helper_gvec_3_ptr * const flogb_fns[] = {
+    NULL,               gen_helper_flogb_h,
+    gen_helper_flogb_s, gen_helper_flogb_d
+};
+TRANS_FEAT(FLOGB, aa64_sve2, gen_gvec_fpst_arg_zpz, flogb_fns[a->esz],
+           a, 0, a->esz == MO_16 ? FPST_FPCR_F16 : FPST_FPCR)
 
 static bool do_FMLAL_zzzw(DisasContext *s, arg_rrrr_esz *a, bool sub, bool sel)
 {
-- 
2.25.1