Series comparison

-[PULL 00/57] target-arm queue
+[PULL 00/72] target-arm queue
-Mostly this is RTH's memtag series, but there are also some cleanups
+First arm pullreq of the cycle; this is mostly my softfloat NaN
-from Philippe.
+handling series. (Lots more in my to-review queue, but I don't
 like pullreqs growing too close to a hundred patches at a time :-))
 thanks
 -- PMM
-The following changes since commit 10f7ffabf9c507fc02382b89912003b1c43c3231:
+The following changes since commit 97f2796a3736ed37a1b85dc1c76a6c45b829dd17:
-  Merge remote-tracking branch 'remotes/mcayland/tags/qemu-macppc-20200626' into staging (2020-06-26 12:14:18 +0100)
+  Open 10.0 development tree (2024-12-10 17:41:17 +0000)
 are available in the Git repository at:
-  https://git.linaro.org/people/pmaydell/qemu-arm.git tags/pull-target-arm-20200626
+  https://git.linaro.org/people/pmaydell/qemu-arm.git tags/pull-target-arm-20241211
-for you to fetch changes up to c7459633baa71d1781fde4a245d6ec9ce2f008cf:
+for you to fetch changes up to 1abe28d519239eea5cf9620bb13149423e5665f8:
-  target/arm: Enable MTE (2020-06-26 14:32:24 +0100)
+  MAINTAINERS: Add correct email address for Vikram Garhwal (2024-12-11 15:31:09 +0000)
 ----------------------------------------------------------------
 target-arm queue:
- * hw/arm/aspeed: improve QOM usage
+ * hw/net/lan9118: Extract PHY model, reuse with imx_fec, fix bugs
- * hw/misc/pca9552: trace GPIO change events
+ * fpu: Make muladd NaN handling runtime-selected, not compile-time
- * target/arm: Implement ARMv8.5-MemTag for system emulation
+ * fpu: Make default NaN pattern runtime-selected, not compile-time
  * fpu: Minor NaN-related cleanups
  * MAINTAINERS: email address updates
 ----------------------------------------------------------------
-Philippe Mathieu-Daudé (12):
+Bernhard Beschow (5):
-      hw/arm/aspeed: Remove extraneous MemoryRegion object owner
+      hw/net/lan9118: Extract lan9118_phy
-      hw/arm/aspeed: Rename AspeedBoardState as AspeedMachineState
+      hw/net/lan9118_phy: Reuse in imx_fec and consolidate implementations
-      hw/arm/aspeed: QOM'ify AspeedMachineState
+      hw/net/lan9118_phy: Fix off-by-one error in MII_ANLPAR register
-      hw/i2c/core: Add i2c_try_create_slave() and i2c_realize_and_unref()
+      hw/net/lan9118_phy: Reuse MII constants
-      hw/misc/pca9552: Rename 'nr_leds' as 'pin_count'
+      hw/net/lan9118_phy: Add missing 100 mbps full duplex advertisement
       hw/misc/pca9552: Rename generic code as pca955x
       hw/misc/pca9552: Add generic PCA955xClass, parent of TYPE_PCA9552
       hw/misc/pca9552: Add a 'description' property for debugging purpose
       hw/misc/pca9552: Trace GPIO High/Low events
       hw/arm/aspeed: Describe each PCA9552 device
       hw/misc/pca9552: Trace GPIO change events
       hw/misc/pca9552: Model qdev output GPIOs
-Richard Henderson (45):
+Leif Lindholm (1):
-      target/arm: Add isar tests for mte
+      MAINTAINERS: update email address for Leif Lindholm
       target/arm: Improve masking of SCR RES0 bits
       target/arm: Add support for MTE to SCTLR_ELx
       target/arm: Add support for MTE to HCR_EL2 and SCR_EL3
       target/arm: Rename DISAS_UPDATE to DISAS_UPDATE_EXIT
       target/arm: Add DISAS_UPDATE_NOCHAIN
       target/arm: Add MTE system registers
       target/arm: Add MTE bits to tb_flags
       target/arm: Implement the IRG instruction
       target/arm: Revise decoding for disas_add_sub_imm
       target/arm: Implement the ADDG, SUBG instructions
       target/arm: Implement the GMI instruction
       target/arm: Implement the SUBP instruction
       target/arm: Define arm_cpu_do_unaligned_access for user-only
       target/arm: Implement LDG, STG, ST2G instructions
       target/arm: Implement the STGP instruction
       target/arm: Restrict the values of DCZID.BS under TCG
       target/arm: Simplify DC_ZVA
       target/arm: Implement the LDGM, STGM, STZGM instructions
       target/arm: Implement the access tag cache flushes
       target/arm: Move regime_el to internals.h
       target/arm: Move regime_tcr to internals.h
       target/arm: Add gen_mte_check1
       target/arm: Add gen_mte_checkN
       target/arm: Implement helper_mte_check1
       target/arm: Implement helper_mte_checkN
       target/arm: Add helper_mte_check_zva
       target/arm: Use mte_checkN for sve unpredicated loads
       target/arm: Use mte_checkN for sve unpredicated stores
       target/arm: Use mte_check1 for sve LD1R
       target/arm: Tidy trans_LD1R_zpri
       target/arm: Add arm_tlb_bti_gp
       target/arm: Add mte helpers for sve scalar + int loads
       target/arm: Add mte helpers for sve scalar + int stores
       target/arm: Add mte helpers for sve scalar + int ff/nf loads
       target/arm: Handle TBI for sve scalar + int memory ops
       target/arm: Add mte helpers for sve scatter/gather memory ops
       target/arm: Complete TBI clearing for user-only for SVE
       target/arm: Implement data cache set allocation tags
       target/arm: Set PSTATE.TCO on exception entry
       target/arm: Always pass cacheattr to get_phys_addr
       target/arm: Cache the Tagged bit for a page in MemTxAttrs
       target/arm: Create tagged ram when MTE is enabled
       target/arm: Add allocation tag storage for system mode
       target/arm: Enable MTE
- include/hw/arm/aspeed.h        |   12 +-
+Peter Maydell (54):
- include/hw/i2c/i2c.h           |    2 +
+      fpu: handle raising Invalid for infzero in pick_nan_muladd
- include/hw/misc/pca9552.h      |   16 +-
+      fpu: Check for default_nan_mode before calling pickNaNMulAdd
- target/arm/cpu.h               |   50 +-
+      softfloat: Allow runtime choice of inf * 0 + NaN result
- target/arm/helper-a64.h        |   16 +
+      tests/fp: Explicitly set inf-zero-nan rule
- target/arm/helper-sve.h        |  488 ++++++++++++++
+      target/arm: Set FloatInfZeroNaNRule explicitly
- target/arm/helper.h            |    2 +
+      target/s390: Set FloatInfZeroNaNRule explicitly
- target/arm/internals.h         |  153 ++++-
+      target/ppc: Set FloatInfZeroNaNRule explicitly
- target/arm/translate-a64.h     |    5 +
+      target/mips: Set FloatInfZeroNaNRule explicitly
- target/arm/translate.h         |   23 +-
+      target/sparc: Set FloatInfZeroNaNRule explicitly
- hw/arm/aspeed.c                |   46 +-
+      target/xtensa: Set FloatInfZeroNaNRule explicitly
- hw/arm/virt.c                  |   55 +-
+      target/x86: Set FloatInfZeroNaNRule explicitly
- hw/i2c/core.c                  |   18 +-
+      target/loongarch: Set FloatInfZeroNaNRule explicitly
- hw/misc/pca9552.c              |  216 +++++--
+      target/hppa: Set FloatInfZeroNaNRule explicitly
- target/arm/cpu.c               |   81 ++-
+      softfloat: Pass have_snan to pickNaNMulAdd
- target/arm/cpu64.c             |    5 +
+      softfloat: Allow runtime choice of NaN propagation for muladd
- target/arm/helper-a64.c        |   94 +--
+      tests/fp: Explicitly set 3-NaN propagation rule
- target/arm/helper.c            |  423 ++++++++++---
+      target/arm: Set Float3NaNPropRule explicitly
- target/arm/m_helper.c          |   11 +-
+      target/loongarch: Set Float3NaNPropRule explicitly
- target/arm/mte_helper.c        |  906 ++++++++++++++++++++++++++
+      target/ppc: Set Float3NaNPropRule explicitly
- target/arm/op_helper.c         |   16 +
+      target/s390x: Set Float3NaNPropRule explicitly
- target/arm/sve_helper.c        |  616 ++++++++++++++----
+      target/sparc: Set Float3NaNPropRule explicitly
- target/arm/tlb_helper.c        |   13 +-
+      target/mips: Set Float3NaNPropRule explicitly
- target/arm/translate-a64.c     |  657 ++++++++++++++++---
+      target/xtensa: Set Float3NaNPropRule explicitly
- target/arm/translate-sve.c     | 1366 ++++++++++++++++++++++++++--------------
+      target/i386: Set Float3NaNPropRule explicitly
- target/arm/translate-vfp.inc.c |    4 +-
+      target/hppa: Set Float3NaNPropRule explicitly
- target/arm/translate.c         |   16 +-
+      fpu: Remove use_first_nan field from float_status
- hw/misc/trace-events           |    4 +
+      target/m68k: Don't pass NULL float_status to floatx80_default_nan()
- target/arm/Makefile.objs       |    1 +
+      softfloat: Create floatx80 default NaN from parts64_default_nan
-files changed, 4391 insertions(+), 924 deletions(-)
+      target/loongarch: Use normal float_status in fclass_s and fclass_d helpers
- create mode 100644 target/arm/mte_helper.c
+      target/m68k: In frem helper, initialize local float_status from env->fp_status
       target/m68k: Init local float_status from env fp_status in gdb get/set reg
       target/sparc: Initialize local scratch float_status from env->fp_status
       target/ppc: Use env->fp_status in helper_compute_fprf functions
       fpu: Allow runtime choice of default NaN value
       tests/fp: Set default NaN pattern explicitly
       target/microblaze: Set default NaN pattern explicitly
       target/i386: Set default NaN pattern explicitly
       target/hppa: Set default NaN pattern explicitly
       target/alpha: Set default NaN pattern explicitly
       target/arm: Set default NaN pattern explicitly
       target/loongarch: Set default NaN pattern explicitly
       target/m68k: Set default NaN pattern explicitly
       target/mips: Set default NaN pattern explicitly
       target/openrisc: Set default NaN pattern explicitly
       target/ppc: Set default NaN pattern explicitly
       target/sh4: Set default NaN pattern explicitly
       target/rx: Set default NaN pattern explicitly
       target/s390x: Set default NaN pattern explicitly
       target/sparc: Set default NaN pattern explicitly
       target/xtensa: Set default NaN pattern explicitly
       target/hexagon: Set default NaN pattern explicitly
       target/riscv: Set default NaN pattern explicitly
       target/tricore: Set default NaN pattern explicitly
       fpu: Remove default handling for dnan_pattern
+Richard Henderson (11):
+      target/arm: Copy entire float_status in is_ebf
+      softfloat: Inline pickNaNMulAdd
+      softfloat: Use goto for default nan case in pick_nan_muladd
+      softfloat: Remove which from parts_pick_nan_muladd
+      softfloat: Pad array size in pick_nan_muladd
+      softfloat: Move propagateFloatx80NaN to softfloat.c
+      softfloat: Use parts_pick_nan in propagateFloatx80NaN
+      softfloat: Inline pickNaN
+      softfloat: Share code between parts_pick_nan cases
+      softfloat: Sink frac_cmp in parts_pick_nan until needed
+      softfloat: Replace WHICH with RET in parts_pick_nan
+Vikram Garhwal (1):
+      MAINTAINERS: Add correct email address for Vikram Garhwal
+ MAINTAINERS                       |   4 +-
+ include/fpu/softfloat-helpers.h   |  38 +++-
+ include/fpu/softfloat-types.h     |  89 +++++++-
+ include/hw/net/imx_fec.h          |   9 +-
+ include/hw/net/lan9118_phy.h      |  37 ++++
+ include/hw/net/mii.h              |   6 +
+ target/mips/fpu_helper.h          |  20 ++
+ target/sparc/helper.h             |   4 +-
+ fpu/softfloat.c                   |  19 ++
+ hw/net/imx_fec.c                  | 146 ++------------
+ hw/net/lan9118.c                  | 137 ++-----------
+ hw/net/lan9118_phy.c              | 222 ++++++++++++++++++++
+ linux-user/arm/nwfpe/fpa11.c      |   5 +
+ target/alpha/cpu.c                |   2 +
+ target/arm/cpu.c                  |  10 +
+ target/arm/tcg/vec_helper.c       |  20 +-
+ target/hexagon/cpu.c              |   2 +
+ target/hppa/fpu_helper.c          |  12 ++
+ target/i386/tcg/fpu_helper.c      |  12 ++
+ target/loongarch/tcg/fpu_helper.c |  14 +-
+ target/m68k/cpu.c                 |  14 +-
+ target/m68k/fpu_helper.c          |   6 +-
+ target/m68k/helper.c              |   6 +-
+ target/microblaze/cpu.c           |   2 +
+ target/mips/msa.c                 |  10 +
+ target/openrisc/cpu.c             |   2 +
+ target/ppc/cpu_init.c             |  19 ++
+ target/ppc/fpu_helper.c           |   3 +-
+ target/riscv/cpu.c                |   2 +
+ target/rx/cpu.c                   |   2 +
+ target/s390x/cpu.c                |   5 +
+ target/sh4/cpu.c                  |   2 +
+ target/sparc/cpu.c                |   6 +
+ target/sparc/fop_helper.c         |   8 +-
+ target/sparc/translate.c          |   4 +-
+ target/tricore/helper.c           |   2 +
+ target/xtensa/cpu.c               |   4 +
+ target/xtensa/fpu_helper.c        |   3 +-
+ tests/fp/fp-bench.c               |   7 +
+ tests/fp/fp-test-log2.c           |   1 +
+ tests/fp/fp-test.c                |   7 +
+ fpu/softfloat-parts.c.inc         | 152 +++++++++++---
+ fpu/softfloat-specialize.c.inc    | 412 ++------------------------------------
+ .mailmap                          |   5 +-
+ hw/net/Kconfig                    |   5 +
+ hw/net/meson.build                |   1 +
+ hw/net/trace-events               |  10 +-
+files changed, 778 insertions(+), 730 deletions(-)
+ create mode 100644 include/hw/net/lan9118_phy.h
+ create mode 100644 hw/net/lan9118_phy.c

-[PULL 21/57] target/arm: Implement the IRG instruction
+[PULL 01/72] hw/net/lan9118: Extract lan9118_phy
-From: Richard Henderson <richard.henderson@linaro.org>
+From: Bernhard Beschow <shentey@gmail.com>
+A very similar implementation of the same device exists in imx_fec. Prepare for
+a common implementation by extracting a device model into its own files.
+Some migration state has been moved into the new device model which breaks
+migration compatibility for the following machines:
+* smdkc210
+* realview-*
+* vexpress-*
+* kzm
+* mps2-*
+While breaking migration ABI, fix the size of the MII registers to be 16 bit,
+as defined by IEEE 802.3u.
+Signed-off-by: Bernhard Beschow <shentey@gmail.com>
+Tested-by: Guenter Roeck <linux@roeck-us.net>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241102125724.532843-2-shentey@gmail.com
 Message-id: 20200626033144.790098-10-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper-a64.h    |  2 ++
+ include/hw/net/lan9118_phy.h |  37 ++++++++
- target/arm/internals.h     |  5 +++
+ hw/net/lan9118.c             | 137 +++++-----------------------
- target/arm/mte_helper.c    | 72 ++++++++++++++++++++++++++++++++++++++
+ hw/net/lan9118_phy.c         | 169 +++++++++++++++++++++++++++++++++++
- target/arm/translate-a64.c | 18 ++++++++++
+ hw/net/Kconfig               |   4 +
- target/arm/Makefile.objs   |  1 +
+ hw/net/meson.build           |   1 +
-files changed, 98 insertions(+)
+files changed, 233 insertions(+), 115 deletions(-)
- create mode 100644 target/arm/mte_helper.c
+ create mode 100644 include/hw/net/lan9118_phy.h
  create mode 100644 hw/net/lan9118_phy.c
-diff --git a/target/arm/helper-a64.h b/target/arm/helper-a64.h
+diff --git a/include/hw/net/lan9118_phy.h b/include/hw/net/lan9118_phy.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper-a64.h
 +++ b/target/arm/helper-a64.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_3(autda, TCG_CALL_NO_WG, i64, env, i64, i64)
  DEF_HELPER_FLAGS_3(autdb, TCG_CALL_NO_WG, i64, env, i64, i64)
  DEF_HELPER_FLAGS_2(xpaci, TCG_CALL_NO_RWG_SE, i64, env, i64)
  DEF_HELPER_FLAGS_2(xpacd, TCG_CALL_NO_RWG_SE, i64, env, i64)
 +
 +DEF_HELPER_FLAGS_3(irg, TCG_CALL_NO_RWG, i64, env, i64, i64)
 diff --git a/target/arm/internals.h b/target/arm/internals.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/internals.h
 +++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ void arm_log_exception(int idx);
   */
  #define GMID_EL1_BS  6
 +static inline uint64_t address_with_allocation_tag(uint64_t ptr, int rtag)
 +{
 +    return deposit64(ptr, 56, 4, rtag);
 +}
 +
  #endif
 diff --git a/target/arm/mte_helper.c b/target/arm/mte_helper.c
 new file mode 100644
 index XXXXXXX..XXXXXXX
 --- /dev/null
-+++ b/target/arm/mte_helper.c
++++ b/include/hw/net/lan9118_phy.h
 @@ -XXX,XX +XXX,XX @@
 +/*
-+ * ARM v8.5-MemTag Operations
++ * SMSC LAN9118 PHY emulation
 + *
-+ * Copyright (c) 2020 Linaro, Ltd.
++ * Copyright (c) 2009 CodeSourcery, LLC.
 + * Written by Paul Brook
 + *
-+ * This library is free software; you can redistribute it and/or
++ * This work is licensed under the terms of the GNU GPL, version 2 or later.
-+ * modify it under the terms of the GNU Lesser General Public
++ * See the COPYING file in the top-level directory.
-+ * License as published by the Free Software Foundation; either
++ */
-+ * version 2.1 of the License, or (at your option) any later version.
++
 +#ifndef HW_NET_LAN9118_PHY_H
 +#define HW_NET_LAN9118_PHY_H
 +
 +#include "qom/object.h"
 +#include "hw/sysbus.h"
 +
 +#define TYPE_LAN9118_PHY "lan9118-phy"
 +OBJECT_DECLARE_SIMPLE_TYPE(Lan9118PhyState, LAN9118_PHY)
 +
 +typedef struct Lan9118PhyState {
 +    SysBusDevice parent_obj;
 +
 +    uint16_t status;
 +    uint16_t control;
 +    uint16_t advertise;
 +    uint16_t ints;
 +    uint16_t int_mask;
 +    qemu_irq irq;
 +    bool link_down;
 +} Lan9118PhyState;
 +
 +void lan9118_phy_update_link(Lan9118PhyState *s, bool link_down);
 +void lan9118_phy_reset(Lan9118PhyState *s);
 +uint16_t lan9118_phy_read(Lan9118PhyState *s, int reg);
 +void lan9118_phy_write(Lan9118PhyState *s, int reg, uint16_t val);
 +
 +#endif
 diff --git a/hw/net/lan9118.c b/hw/net/lan9118.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/net/lan9118.c
 +++ b/hw/net/lan9118.c
@@ -XXX,XX +XXX,XX @@
  #include "net/net.h"
  #include "net/eth.h"
  #include "hw/irq.h"
 +#include "hw/net/lan9118_phy.h"
  #include "hw/net/lan9118.h"
  #include "hw/ptimer.h"
  #include "hw/qdev-properties.h"
@@ -XXX,XX +XXX,XX @@ do { printf("lan9118: " fmt , ## __VA_ARGS__); } while (0)
  #define MAC_CR_RXEN     0x00000004
  #define MAC_CR_RESERVED 0x7f404213
 -#define PHY_INT_ENERGYON            0x80
 -#define PHY_INT_AUTONEG_COMPLETE    0x40
 -#define PHY_INT_FAULT               0x20
 -#define PHY_INT_DOWN                0x10
 -#define PHY_INT_AUTONEG_LP          0x08
 -#define PHY_INT_PARFAULT            0x04
 -#define PHY_INT_AUTONEG_PAGE        0x02
 -
  #define GPT_TIMER_EN    0x20000000
  /*
@@ -XXX,XX +XXX,XX @@ struct lan9118_state {
      uint32_t mac_mii_data;
      uint32_t mac_flow;
 -    uint32_t phy_status;
 -    uint32_t phy_control;
 -    uint32_t phy_advertise;
 -    uint32_t phy_int;
 -    uint32_t phy_int_mask;
 +    Lan9118PhyState mii;
 +    IRQState mii_irq;
      int32_t eeprom_writable;
      uint8_t eeprom[128];
@@ -XXX,XX +XXX,XX @@ struct lan9118_state {
  static const VMStateDescription vmstate_lan9118 = {
      .name = "lan9118",
 -    .version_id = 2,
 -    .minimum_version_id = 1,
 +    .version_id = 3,
 +    .minimum_version_id = 3,
      .fields = (const VMStateField[]) {
          VMSTATE_PTIMER(timer, lan9118_state),
          VMSTATE_UINT32(irq_cfg, lan9118_state),
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_lan9118 = {
          VMSTATE_UINT32(mac_mii_acc, lan9118_state),
          VMSTATE_UINT32(mac_mii_data, lan9118_state),
          VMSTATE_UINT32(mac_flow, lan9118_state),
 -        VMSTATE_UINT32(phy_status, lan9118_state),
 -        VMSTATE_UINT32(phy_control, lan9118_state),
 -        VMSTATE_UINT32(phy_advertise, lan9118_state),
 -        VMSTATE_UINT32(phy_int, lan9118_state),
 -        VMSTATE_UINT32(phy_int_mask, lan9118_state),
          VMSTATE_INT32(eeprom_writable, lan9118_state),
          VMSTATE_UINT8_ARRAY(eeprom, lan9118_state, 128),
          VMSTATE_INT32(tx_fifo_size, lan9118_state),
@@ -XXX,XX +XXX,XX @@ static void lan9118_reload_eeprom(lan9118_state *s)
      lan9118_mac_changed(s);
  }
 -static void phy_update_irq(lan9118_state *s)
 +static void lan9118_update_irq(void *opaque, int n, int level)
  {
 -    if (s->phy_int & s->phy_int_mask) {
 +    lan9118_state *s = opaque;
 +
 +    if (level) {
          s->int_sts |= PHY_INT;
      } else {
          s->int_sts &= ~PHY_INT;
@@ -XXX,XX +XXX,XX @@ static void phy_update_irq(lan9118_state *s)
      lan9118_update(s);
  }
 -static void phy_update_link(lan9118_state *s)
 -{
 -    /* Autonegotiation status mirrors link status.  */
 -    if (qemu_get_queue(s->nic)->link_down) {
 -        s->phy_status &= ~0x0024;
 -        s->phy_int |= PHY_INT_DOWN;
 -    } else {
 -        s->phy_status |= 0x0024;
 -        s->phy_int |= PHY_INT_ENERGYON;
 -        s->phy_int |= PHY_INT_AUTONEG_COMPLETE;
 -    }
 -    phy_update_irq(s);
 -}
 -
  static void lan9118_set_link(NetClientState *nc)
  {
 -    phy_update_link(qemu_get_nic_opaque(nc));
 -}
 -
 -static void phy_reset(lan9118_state *s)
 -{
 -    s->phy_status = 0x7809;
 -    s->phy_control = 0x3000;
 -    s->phy_advertise = 0x01e1;
 -    s->phy_int_mask = 0;
 -    s->phy_int = 0;
 -    phy_update_link(s);
 +    lan9118_phy_update_link(&LAN9118(qemu_get_nic_opaque(nc))->mii,
 +                            nc->link_down);
  }
  static void lan9118_reset(DeviceState *d)
@@ -XXX,XX +XXX,XX @@ static void lan9118_reset(DeviceState *d)
      s->read_word_n = 0;
      s->write_word_n = 0;
 -    phy_reset(s);
 -
      s->eeprom_writable = 0;
      lan9118_reload_eeprom(s);
  }
@@ -XXX,XX +XXX,XX @@ static void do_tx_packet(lan9118_state *s)
      uint32_t status;
      /* FIXME: Honor TX disable, and allow queueing of packets.  */
 -    if (s->phy_control & 0x4000)  {
 +    if (s->mii.control & 0x4000) {
          /* This assumes the receive routine doesn't touch the VLANClient.  */
          qemu_receive_packet(qemu_get_queue(s->nic), s->txp->data, s->txp->len);
      } else {
@@ -XXX,XX +XXX,XX @@ static void tx_fifo_push(lan9118_state *s, uint32_t val)
      }
  }
 -static uint32_t do_phy_read(lan9118_state *s, int reg)
 -{
 -    uint32_t val;
 -
 -    switch (reg) {
 -    case 0: /* Basic Control */
 -        return s->phy_control;
 -    case 1: /* Basic Status */
 -        return s->phy_status;
 -    case 2: /* ID1 */
 -        return 0x0007;
 -    case 3: /* ID2 */
 -        return 0xc0d1;
 -    case 4: /* Auto-neg advertisement */
 -        return s->phy_advertise;
 -    case 5: /* Auto-neg Link Partner Ability */
 -        return 0x0f71;
 -    case 6: /* Auto-neg Expansion */
 -        return 1;
 -        /* TODO 17, 18, 27, 29, 30, 31 */
 -    case 29: /* Interrupt source.  */
 -        val = s->phy_int;
 -        s->phy_int = 0;
 -        phy_update_irq(s);
 -        return val;
 -    case 30: /* Interrupt mask */
 -        return s->phy_int_mask;
 -    default:
 -        qemu_log_mask(LOG_GUEST_ERROR,
 -                      "do_phy_read: PHY read reg %d\n", reg);
 -        return 0;
 -    }
 -}
 -
 -static void do_phy_write(lan9118_state *s, int reg, uint32_t val)
 -{
 -    switch (reg) {
 -    case 0: /* Basic Control */
 -        if (val & 0x8000) {
 -            phy_reset(s);
 -            break;
 -        }
 -        s->phy_control = val & 0x7980;
 -        /* Complete autonegotiation immediately.  */
 -        if (val & 0x1000) {
 -            s->phy_status |= 0x0020;
 -        }
 -        break;
 -    case 4: /* Auto-neg advertisement */
 -        s->phy_advertise = (val & 0x2d7f) | 0x80;
 -        break;
 -        /* TODO 17, 18, 27, 31 */
 -    case 30: /* Interrupt mask */
 -        s->phy_int_mask = val & 0xff;
 -        phy_update_irq(s);
 -        break;
 -    default:
 -        qemu_log_mask(LOG_GUEST_ERROR,
 -                      "do_phy_write: PHY write reg %d = 0x%04x\n", reg, val);
 -    }
 -}
 -
  static void do_mac_write(lan9118_state *s, int reg, uint32_t val)
  {
      switch (reg) {
@@ -XXX,XX +XXX,XX @@ static void do_mac_write(lan9118_state *s, int reg, uint32_t val)
          if (val & 2) {
              DPRINTF("PHY write %d = 0x%04x\n",
                      (val >> 6) & 0x1f, s->mac_mii_data);
 -            do_phy_write(s, (val >> 6) & 0x1f, s->mac_mii_data);
 +            lan9118_phy_write(&s->mii, (val >> 6) & 0x1f, s->mac_mii_data);
          } else {
 -            s->mac_mii_data = do_phy_read(s, (val >> 6) & 0x1f);
 +            s->mac_mii_data = lan9118_phy_read(&s->mii, (val >> 6) & 0x1f);
              DPRINTF("PHY read %d = 0x%04x\n",
                      (val >> 6) & 0x1f, s->mac_mii_data);
          }
@@ -XXX,XX +XXX,XX @@ static void lan9118_writel(void *opaque, hwaddr offset,
          break;
      case CSR_PMT_CTRL:
          if (val & 0x400) {
 -            phy_reset(s);
 +            lan9118_phy_reset(&s->mii);
          }
          s->pmt_ctrl &= ~0x34e;
          s->pmt_ctrl |= (val & 0x34e);
@@ -XXX,XX +XXX,XX @@ static void lan9118_realize(DeviceState *dev, Error **errp)
      const MemoryRegionOps *mem_ops =
              s->mode_16bit ? &lan9118_16bit_mem_ops : &lan9118_mem_ops;
 +    qemu_init_irq(&s->mii_irq, lan9118_update_irq, s, 0);
 +    object_initialize_child(OBJECT(s), "mii", &s->mii, TYPE_LAN9118_PHY);
 +    if (!sysbus_realize_and_unref(SYS_BUS_DEVICE(&s->mii), errp)) {
 +        return;
 +    }
 +    qdev_connect_gpio_out(DEVICE(&s->mii), 0, &s->mii_irq);
 +
      memory_region_init_io(&s->mmio, OBJECT(dev), mem_ops, s,
                            "lan9118-mmio", 0x100);
      sysbus_init_mmio(sbd, &s->mmio);
 diff --git a/hw/net/lan9118_phy.c b/hw/net/lan9118_phy.c
 new file mode 100644
 index XXXXXXX..XXXXXXX
 --- /dev/null
 +++ b/hw/net/lan9118_phy.c
@@ -XXX,XX +XXX,XX @@
 +/*
 + * SMSC LAN9118 PHY emulation
 + *
-+ * This library is distributed in the hope that it will be useful,
++ * Copyright (c) 2009 CodeSourcery, LLC.
-+ * but WITHOUT ANY WARRANTY; without even the implied warranty of
++ * Written by Paul Brook
 + * MERCHANTABILITY or FITNESS FOR A PARTICULAR PURPOSE.  See the GNU
 + * Lesser General Public License for more details.
 + *
-+ * You should have received a copy of the GNU Lesser General Public
++ * This code is licensed under the GNU GPL v2
-+ * License along with this library; if not, see <http://www.gnu.org/licenses/>.
++ *
 + * Contributions after 2012-01-13 are licensed under the terms of the
 + * GNU GPL, version 2 or (at your option) any later version.
 + */
 +
 +#include "qemu/osdep.h"
-+#include "cpu.h"
++#include "hw/net/lan9118_phy.h"
-+#include "internals.h"
++#include "hw/irq.h"
-+#include "exec/exec-all.h"
++#include "hw/resettable.h"
-+#include "exec/cpu_ldst.h"
++#include "migration/vmstate.h"
-+#include "exec/helper-proto.h"
++#include "qemu/log.h"
 +
-+
++#define PHY_INT_ENERGYON            (1 << 7)
-+static int choose_nonexcluded_tag(int tag, int offset, uint16_t exclude)
++#define PHY_INT_AUTONEG_COMPLETE    (1 << 6)
-+{
++#define PHY_INT_FAULT               (1 << 5)
-+    if (exclude == 0xffff) {
++#define PHY_INT_DOWN                (1 << 4)
 +#define PHY_INT_AUTONEG_LP          (1 << 3)
 +#define PHY_INT_PARFAULT            (1 << 2)
 +#define PHY_INT_AUTONEG_PAGE        (1 << 1)
 +
 +static void lan9118_phy_update_irq(Lan9118PhyState *s)
 +{
 +    qemu_set_irq(s->irq, !!(s->ints & s->int_mask));
 +}
 +
 +uint16_t lan9118_phy_read(Lan9118PhyState *s, int reg)
 +{
 +    uint16_t val;
 +
 +    switch (reg) {
 +    case 0: /* Basic Control */
 +        return s->control;
 +    case 1: /* Basic Status */
 +        return s->status;
 +    case 2: /* ID1 */
 +        return 0x0007;
 +    case 3: /* ID2 */
 +        return 0xc0d1;
 +    case 4: /* Auto-neg advertisement */
 +        return s->advertise;
 +    case 5: /* Auto-neg Link Partner Ability */
 +        return 0x0f71;
 +    case 6: /* Auto-neg Expansion */
 +        return 1;
 +        /* TODO 17, 18, 27, 29, 30, 31 */
 +    case 29: /* Interrupt source. */
 +        val = s->ints;
 +        s->ints = 0;
 +        lan9118_phy_update_irq(s);
 +        return val;
 +    case 30: /* Interrupt mask */
 +        return s->int_mask;
 +    default:
 +        qemu_log_mask(LOG_GUEST_ERROR,
 +                      "lan9118_phy_read: PHY read reg %d\n", reg);
 +        return 0;
 +    }
-+    if (offset == 0) {
++}
-+        while (exclude & (1 << tag)) {
++
-+            tag = (tag + 1) & 15;
++void lan9118_phy_write(Lan9118PhyState *s, int reg, uint16_t val)
 +{
 +    switch (reg) {
 +    case 0: /* Basic Control */
 +        if (val & 0x8000) {
 +            lan9118_phy_reset(s);
 +            break;
 +        }
-+    } else {
++        s->control = val & 0x7980;
-+        do {
++        /* Complete autonegotiation immediately. */
-+            do {
++        if (val & 0x1000) {
-+                tag = (tag + 1) & 15;
++            s->status |= 0x0020;
 +            } while (exclude & (1 << tag));
 +        } while (--offset > 0);
 +    }
 +    return tag;
 +}
 +
 +uint64_t HELPER(irg)(CPUARMState *env, uint64_t rn, uint64_t rm)
 +{
 +    int rtag;
 +
 +    /*
 +     * Our IMPDEF choice for GCR_EL1.RRND==1 is to behave as if
 +     * GCR_EL1.RRND==0, always producing deterministic results.
 +     */
 +    uint16_t exclude = extract32(rm | env->cp15.gcr_el1, 0, 16);
 +    int start = extract32(env->cp15.rgsr_el1, 0, 4);
 +    int seed = extract32(env->cp15.rgsr_el1, 8, 16);
 +    int offset, i;
 +
 +    /* RandomTag */
 +    for (i = offset = 0; i < 4; ++i) {
 +        /* NextRandomTagBit */
 +        int top = (extract32(seed, 5, 1) ^ extract32(seed, 3, 1) ^
 +                   extract32(seed, 2, 1) ^ extract32(seed, 0, 1));
 +        seed = (top << 15) | (seed >> 1);
 +        offset |= top << i;
 +    }
 +    rtag = choose_nonexcluded_tag(start, offset, exclude);
 +    env->cp15.rgsr_el1 = rtag | (seed << 8);
 +
 +    return address_with_allocation_tag(rn, rtag);
 +}
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static TCGv_i64 clean_data_tbi(DisasContext *s, TCGv_i64 addr)
      return clean;
  }
 +/* Insert a zero tag into src, with the result at dst. */
 +static void gen_address_with_allocation_tag0(TCGv_i64 dst, TCGv_i64 src)
 +{
 +    tcg_gen_andi_i64(dst, src, ~MAKE_64BIT_MASK(56, 4));
 +}
 +
  typedef struct DisasCompare64 {
      TCGCond cond;
      TCGv_i64 value;
@@ -XXX,XX +XXX,XX @@ static void disas_data_proc_2src(DisasContext *s, uint32_t insn)
      case 3: /* SDIV */
          handle_div(s, true, sf, rm, rn, rd);
          break;
 +    case 4: /* IRG */
 +        if (sf == 0 || !dc_isar_feature(aa64_mte_insn_reg, s)) {
 +            goto do_unallocated;
 +        }
 +        if (s->ata) {
 +            gen_helper_irg(cpu_reg_sp(s, rd), cpu_env,
 +                           cpu_reg_sp(s, rn), cpu_reg(s, rm));
 +        } else {
 +            gen_address_with_allocation_tag0(cpu_reg_sp(s, rd),
 +                                             cpu_reg_sp(s, rn));
 +        }
 +        break;
-     case 8: /* LSLV */
++    case 4: /* Auto-neg advertisement */
-         handle_shift_reg(s, A64_SHIFT_TYPE_LSL, sf, rm, rn, rd);
++        s->advertise = (val & 0x2d7f) | 0x80;
-         break;
++        break;
-diff --git a/target/arm/Makefile.objs b/target/arm/Makefile.objs
++        /* TODO 17, 18, 27, 31 */
 +    case 30: /* Interrupt mask */
 +        s->int_mask = val & 0xff;
 +        lan9118_phy_update_irq(s);
 +        break;
 +    default:
 +        qemu_log_mask(LOG_GUEST_ERROR,
 +                      "lan9118_phy_write: PHY write reg %d = 0x%04x\n", reg, val);
 +    }
 +}
 +
 +void lan9118_phy_update_link(Lan9118PhyState *s, bool link_down)
 +{
 +    s->link_down = link_down;
 +
 +    /* Autonegotiation status mirrors link status. */
 +    if (link_down) {
 +        s->status &= ~0x0024;
 +        s->ints |= PHY_INT_DOWN;
 +    } else {
 +        s->status |= 0x0024;
 +        s->ints |= PHY_INT_ENERGYON;
 +        s->ints |= PHY_INT_AUTONEG_COMPLETE;
 +    }
 +    lan9118_phy_update_irq(s);
 +}
 +
 +void lan9118_phy_reset(Lan9118PhyState *s)
 +{
 +    s->control = 0x3000;
 +    s->status = 0x7809;
 +    s->advertise = 0x01e1;
 +    s->int_mask = 0;
 +    s->ints = 0;
 +    lan9118_phy_update_link(s, s->link_down);
 +}
 +
 +static void lan9118_phy_reset_hold(Object *obj, ResetType type)
 +{
 +    Lan9118PhyState *s = LAN9118_PHY(obj);
 +
 +    lan9118_phy_reset(s);
 +}
 +
 +static void lan9118_phy_init(Object *obj)
 +{
 +    Lan9118PhyState *s = LAN9118_PHY(obj);
 +
 +    qdev_init_gpio_out(DEVICE(s), &s->irq, 1);
 +}
 +
 +static const VMStateDescription vmstate_lan9118_phy = {
 +    .name = "lan9118-phy",
 +    .version_id = 1,
 +    .minimum_version_id = 1,
 +    .fields = (const VMStateField[]) {
 +        VMSTATE_UINT16(control, Lan9118PhyState),
 +        VMSTATE_UINT16(status, Lan9118PhyState),
 +        VMSTATE_UINT16(advertise, Lan9118PhyState),
 +        VMSTATE_UINT16(ints, Lan9118PhyState),
 +        VMSTATE_UINT16(int_mask, Lan9118PhyState),
 +        VMSTATE_BOOL(link_down, Lan9118PhyState),
 +        VMSTATE_END_OF_LIST()
 +    }
 +};
 +
 +static void lan9118_phy_class_init(ObjectClass *klass, void *data)
 +{
 +    ResettableClass *rc = RESETTABLE_CLASS(klass);
 +    DeviceClass *dc = DEVICE_CLASS(klass);
 +
 +    rc->phases.hold = lan9118_phy_reset_hold;
 +    dc->vmsd = &vmstate_lan9118_phy;
 +}
 +
 +static const TypeInfo types[] = {
 +    {
 +        .name          = TYPE_LAN9118_PHY,
 +        .parent        = TYPE_SYS_BUS_DEVICE,
 +        .instance_size = sizeof(Lan9118PhyState),
 +        .instance_init = lan9118_phy_init,
 +        .class_init    = lan9118_phy_class_init,
 +    }
 +};
 +
 +DEFINE_TYPES(types)
 diff --git a/hw/net/Kconfig b/hw/net/Kconfig
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/Makefile.objs
+--- a/hw/net/Kconfig
-+++ b/target/arm/Makefile.objs
++++ b/hw/net/Kconfig
-@@ -XXX,XX +XXX,XX @@ obj-$(CONFIG_SOFTMMU) += psci.o
+@@ -XXX,XX +XXX,XX @@ config VMXNET3_PCI
- obj-$(TARGET_AARCH64) += translate-a64.o helper-a64.o
+ config SMC91C111
- obj-$(TARGET_AARCH64) += translate-sve.o sve_helper.o
+     bool
- obj-$(TARGET_AARCH64) += pauth_helper.o
-+obj-$(TARGET_AARCH64) += mte_helper.o
++config LAN9118_PHY
 +    bool
 +
  config LAN9118
      bool
 +    select LAN9118_PHY
      select PTIMER
  config NE2000_ISA
 diff --git a/hw/net/meson.build b/hw/net/meson.build
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/net/meson.build
 +++ b/hw/net/meson.build
@@ -XXX,XX +XXX,XX @@ system_ss.add(when: 'CONFIG_VMXNET3_PCI', if_true: files('vmxnet3.c'))
  system_ss.add(when: 'CONFIG_SMC91C111', if_true: files('smc91c111.c'))
  system_ss.add(when: 'CONFIG_LAN9118', if_true: files('lan9118.c'))
 +system_ss.add(when: 'CONFIG_LAN9118_PHY', if_true: files('lan9118_phy.c'))
  system_ss.add(when: 'CONFIG_NE2000_ISA', if_true: files('ne2000-isa.c'))
  system_ss.add(when: 'CONFIG_OPENCORES_ETH', if_true: files('opencores_eth.c'))
  system_ss.add(when: 'CONFIG_XGMAC', if_true: files('xgmac.c'))
 --
-.20.1
+.34.1

-[PULL 48/57] target/arm: Handle TBI for sve scalar + int memory ops
+[PULL 02/72] hw/net/lan9118_phy: Reuse in imx_fec and consolidate implementations
-From: Richard Henderson <richard.henderson@linaro.org>
+From: Bernhard Beschow <shentey@gmail.com>
-We still need to handle tbi for user-only when mte is inactive.
+imx_fec models the same PHY as lan9118_phy. The code is almost the same with
 imx_fec having more logging and tracing. Merge these improvements into
 lan9118_phy and reuse in imx_fec to fix the code duplication.
+Some migration state how resides in the new device model which breaks migration
+compatibility for the following machines:
+* imx25-pdk
+* sabrelite
+* mcimx7d-sabre
+* mcimx6ul-evk
+Signed-off-by: Bernhard Beschow <shentey@gmail.com>
+Tested-by: Guenter Roeck <linux@roeck-us.net>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241102125724.532843-3-shentey@gmail.com
 Message-id: 20200626033144.790098-37-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate-a64.h | 1 +
+ include/hw/net/imx_fec.h |   9 ++-
- target/arm/translate-a64.c | 2 +-
+ hw/net/imx_fec.c         | 146 ++++-----------------------------------
- target/arm/translate-sve.c | 6 ++++--
+ hw/net/lan9118_phy.c     |  82 ++++++++++++++++------
-files changed, 6 insertions(+), 3 deletions(-)
+ hw/net/Kconfig           |   1 +
  hw/net/trace-events      |  10 +--
 files changed, 85 insertions(+), 163 deletions(-)
-diff --git a/target/arm/translate-a64.h b/target/arm/translate-a64.h
+diff --git a/include/hw/net/imx_fec.h b/include/hw/net/imx_fec.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-a64.h
+--- a/include/hw/net/imx_fec.h
-+++ b/target/arm/translate-a64.h
++++ b/include/hw/net/imx_fec.h
-@@ -XXX,XX +XXX,XX @@ TCGv_ptr get_fpstatus_ptr(bool);
+@@ -XXX,XX +XXX,XX @@ OBJECT_DECLARE_SIMPLE_TYPE(IMXFECState, IMX_FEC)
- bool logic_imm_decode_wmask(uint64_t *result, unsigned int immn,
+ #define TYPE_IMX_ENET "imx.enet"
-                             unsigned int imms, unsigned int immr);
- bool sve_access_check(DisasContext *s);
+ #include "hw/sysbus.h"
-+TCGv_i64 clean_data_tbi(DisasContext *s, TCGv_i64 addr);
++#include "hw/net/lan9118_phy.h"
- TCGv_i64 gen_mte_check1(DisasContext *s, TCGv_i64 addr, bool is_write,
++#include "hw/irq.h"
-                         bool tag_checked, int log2_size);
+ #include "net/net.h"
- TCGv_i64 gen_mte_checkN(DisasContext *s, TCGv_i64 addr, bool is_write,
-diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
+ #define ENET_EIR               1
@@ -XXX,XX +XXX,XX @@ struct IMXFECState {
      uint32_t tx_descriptor[ENET_TX_RING_NUM];
      uint32_t tx_ring_num;
 -    uint32_t phy_status;
 -    uint32_t phy_control;
 -    uint32_t phy_advertise;
 -    uint32_t phy_int;
 -    uint32_t phy_int_mask;
 +    Lan9118PhyState mii;
 +    IRQState mii_irq;
      uint32_t phy_num;
      bool phy_connected;
      struct IMXFECState *phy_consumer;
 diff --git a/hw/net/imx_fec.c b/hw/net/imx_fec.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-a64.c
+--- a/hw/net/imx_fec.c
-+++ b/target/arm/translate-a64.c
++++ b/hw/net/imx_fec.c
-@@ -XXX,XX +XXX,XX @@ static void gen_a64_set_pc(DisasContext *s, TCGv_i64 src)
+@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_imx_eth_txdescs = {
-  * of the write-back address.
  static const VMStateDescription vmstate_imx_eth = {
      .name = TYPE_IMX_FEC,
 -    .version_id = 2,
 -    .minimum_version_id = 2,
 +    .version_id = 3,
 +    .minimum_version_id = 3,
      .fields = (const VMStateField[]) {
          VMSTATE_UINT32_ARRAY(regs, IMXFECState, ENET_MAX),
          VMSTATE_UINT32(rx_descriptor, IMXFECState),
          VMSTATE_UINT32(tx_descriptor[0], IMXFECState),
 -        VMSTATE_UINT32(phy_status, IMXFECState),
 -        VMSTATE_UINT32(phy_control, IMXFECState),
 -        VMSTATE_UINT32(phy_advertise, IMXFECState),
 -        VMSTATE_UINT32(phy_int, IMXFECState),
 -        VMSTATE_UINT32(phy_int_mask, IMXFECState),
          VMSTATE_END_OF_LIST()
      },
      .subsections = (const VMStateDescription * const []) {
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_imx_eth = {
      },
  };
 -#define PHY_INT_ENERGYON            (1 << 7)
 -#define PHY_INT_AUTONEG_COMPLETE    (1 << 6)
 -#define PHY_INT_FAULT               (1 << 5)
 -#define PHY_INT_DOWN                (1 << 4)
 -#define PHY_INT_AUTONEG_LP          (1 << 3)
 -#define PHY_INT_PARFAULT            (1 << 2)
 -#define PHY_INT_AUTONEG_PAGE        (1 << 1)
 -
  static void imx_eth_update(IMXFECState *s);
  /*
@@ -XXX,XX +XXX,XX @@ static void imx_eth_update(IMXFECState *s);
   * For now we don't handle any GPIO/interrupt line, so the OS will
   * have to poll for the PHY status.
   */
+-static void imx_phy_update_irq(IMXFECState *s)
--static TCGv_i64 clean_data_tbi(DisasContext *s, TCGv_i64 addr)
++static void imx_phy_update_irq(void *opaque, int n, int level)
 +TCGv_i64 clean_data_tbi(DisasContext *s, TCGv_i64 addr)
  {
-     TCGv_i64 clean = new_tmp_a64(s);
+-    imx_eth_update(s);
- #ifdef CONFIG_USER_ONLY
+-}
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+-
 -static void imx_phy_update_link(IMXFECState *s)
 -{
 -    /* Autonegotiation status mirrors link status.  */
 -    if (qemu_get_queue(s->nic)->link_down) {
 -        trace_imx_phy_update_link("down");
 -        s->phy_status &= ~0x0024;
 -        s->phy_int |= PHY_INT_DOWN;
 -    } else {
 -        trace_imx_phy_update_link("up");
 -        s->phy_status |= 0x0024;
 -        s->phy_int |= PHY_INT_ENERGYON;
 -        s->phy_int |= PHY_INT_AUTONEG_COMPLETE;
 -    }
 -    imx_phy_update_irq(s);
 +    imx_eth_update(opaque);
  }
  static void imx_eth_set_link(NetClientState *nc)
  {
 -    imx_phy_update_link(IMX_FEC(qemu_get_nic_opaque(nc)));
 -}
 -
 -static void imx_phy_reset(IMXFECState *s)
 -{
 -    trace_imx_phy_reset();
 -
 -    s->phy_status = 0x7809;
 -    s->phy_control = 0x3000;
 -    s->phy_advertise = 0x01e1;
 -    s->phy_int_mask = 0;
 -    s->phy_int = 0;
 -    imx_phy_update_link(s);
 +    lan9118_phy_update_link(&IMX_FEC(qemu_get_nic_opaque(nc))->mii,
 +                            nc->link_down);
  }
  static uint32_t imx_phy_read(IMXFECState *s, int reg)
  {
 -    uint32_t val;
      uint32_t phy = reg / 32;
      if (!s->phy_connected) {
@@ -XXX,XX +XXX,XX @@ static uint32_t imx_phy_read(IMXFECState *s, int reg)
      reg %= 32;
 -    switch (reg) {
 -    case 0:     /* Basic Control */
 -        val = s->phy_control;
 -        break;
 -    case 1:     /* Basic Status */
 -        val = s->phy_status;
 -        break;
 -    case 2:     /* ID1 */
 -        val = 0x0007;
 -        break;
 -    case 3:     /* ID2 */
 -        val = 0xc0d1;
 -        break;
 -    case 4:     /* Auto-neg advertisement */
 -        val = s->phy_advertise;
 -        break;
 -    case 5:     /* Auto-neg Link Partner Ability */
 -        val = 0x0f71;
 -        break;
 -    case 6:     /* Auto-neg Expansion */
 -        val = 1;
 -        break;
 -    case 29:    /* Interrupt source.  */
 -        val = s->phy_int;
 -        s->phy_int = 0;
 -        imx_phy_update_irq(s);
 -        break;
 -    case 30:    /* Interrupt mask */
 -        val = s->phy_int_mask;
 -        break;
 -    case 17:
 -    case 18:
 -    case 27:
 -    case 31:
 -        qemu_log_mask(LOG_UNIMP, "[%s.phy]%s: reg %d not implemented\n",
 -                      TYPE_IMX_FEC, __func__, reg);
 -        val = 0;
 -        break;
 -    default:
 -        qemu_log_mask(LOG_GUEST_ERROR, "[%s.phy]%s: Bad address at offset %d\n",
 -                      TYPE_IMX_FEC, __func__, reg);
 -        val = 0;
 -        break;
 -    }
 -
 -    trace_imx_phy_read(val, phy, reg);
 -
 -    return val;
 +    return lan9118_phy_read(&s->mii, reg);
  }
  static void imx_phy_write(IMXFECState *s, int reg, uint32_t val)
@@ -XXX,XX +XXX,XX @@ static void imx_phy_write(IMXFECState *s, int reg, uint32_t val)
      reg %= 32;
 -    trace_imx_phy_write(val, phy, reg);
 -
 -    switch (reg) {
 -    case 0:     /* Basic Control */
 -        if (val & 0x8000) {
 -            imx_phy_reset(s);
 -        } else {
 -            s->phy_control = val & 0x7980;
 -            /* Complete autonegotiation immediately.  */
 -            if (val & 0x1000) {
 -                s->phy_status |= 0x0020;
 -            }
 -        }
 -        break;
 -    case 4:     /* Auto-neg advertisement */
 -        s->phy_advertise = (val & 0x2d7f) | 0x80;
 -        break;
 -    case 30:    /* Interrupt mask */
 -        s->phy_int_mask = val & 0xff;
 -        imx_phy_update_irq(s);
 -        break;
 -    case 17:
 -    case 18:
 -    case 27:
 -    case 31:
 -        qemu_log_mask(LOG_UNIMP, "[%s.phy)%s: reg %d not implemented\n",
 -                      TYPE_IMX_FEC, __func__, reg);
 -        break;
 -    default:
 -        qemu_log_mask(LOG_GUEST_ERROR, "[%s.phy]%s: Bad address at offset %d\n",
 -                      TYPE_IMX_FEC, __func__, reg);
 -        break;
 -    }
 +    lan9118_phy_write(&s->mii, reg, val);
  }
  static void imx_fec_read_bd(IMXFECBufDesc *bd, dma_addr_t addr)
@@ -XXX,XX +XXX,XX @@ static void imx_eth_reset(DeviceState *d)
      s->rx_descriptor = 0;
      memset(s->tx_descriptor, 0, sizeof(s->tx_descriptor));
 -
 -    /* We also reset the PHY */
 -    imx_phy_reset(s);
  }
  static uint32_t imx_default_read(IMXFECState *s, uint32_t index)
@@ -XXX,XX +XXX,XX @@ static void imx_eth_realize(DeviceState *dev, Error **errp)
      sysbus_init_irq(sbd, &s->irq[0]);
      sysbus_init_irq(sbd, &s->irq[1]);
 +    qemu_init_irq(&s->mii_irq, imx_phy_update_irq, s, 0);
 +    object_initialize_child(OBJECT(s), "mii", &s->mii, TYPE_LAN9118_PHY);
 +    if (!sysbus_realize_and_unref(SYS_BUS_DEVICE(&s->mii), errp)) {
 +        return;
 +    }
 +    qdev_connect_gpio_out(DEVICE(&s->mii), 0, &s->mii_irq);
 +
      qemu_macaddr_default_if_unset(&s->conf.macaddr);
      s->nic = qemu_new_nic(&imx_eth_net_info, &s->conf,
 diff --git a/hw/net/lan9118_phy.c b/hw/net/lan9118_phy.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
+--- a/hw/net/lan9118_phy.c
-+++ b/target/arm/translate-sve.c
++++ b/hw/net/lan9118_phy.c
-@@ -XXX,XX +XXX,XX @@ static void do_mem_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
+@@ -XXX,XX +XXX,XX @@
-      * For e.g. LD4, there are not enough arguments to pass all 4
+  * Copyright (c) 2009 CodeSourcery, LLC.
-      * registers as pointers, so encode the regno into the data field.
+  * Written by Paul Brook
-      * For consistency, do this even for LD1.
+  *
--     * TODO: mte_n check here while callers are updated.
++ * Copyright (c) 2013 Jean-Christophe Dubois. <jcd@tribudubois.net>
-      */
++ *
--    if (mte_n && s->mte_active[0]) {
+  * This code is licensed under the GNU GPL v2
-+    if (s->mte_active[0]) {
+  *
-         int msz = dtype_msz(dtype);
+  * Contributions after 2012-01-13 are licensed under the terms of the
+@@ -XXX,XX +XXX,XX @@
-         desc = FIELD_DP32(desc, MTEDESC, MIDX, get_mem_index(s));
+ #include "hw/resettable.h"
-@@ -XXX,XX +XXX,XX @@ static void do_mem_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
+ #include "migration/vmstate.h"
-         desc = FIELD_DP32(desc, MTEDESC, ESIZE, 1 << msz);
+ #include "qemu/log.h"
-         desc = FIELD_DP32(desc, MTEDESC, TSIZE, mte_n << msz);
++#include "trace.h"
-         desc <<= SVE_MTEDESC_SHIFT;
-+    } else {
+ #define PHY_INT_ENERGYON            (1 << 7)
-+        addr = clean_data_tbi(s, addr);
+ #define PHY_INT_AUTONEG_COMPLETE    (1 << 6)
@@ -XXX,XX +XXX,XX @@ uint16_t lan9118_phy_read(Lan9118PhyState *s, int reg)
      switch (reg) {
      case 0: /* Basic Control */
 -        return s->control;
 +        val = s->control;
 +        break;
      case 1: /* Basic Status */
 -        return s->status;
 +        val = s->status;
 +        break;
      case 2: /* ID1 */
 -        return 0x0007;
 +        val = 0x0007;
 +        break;
      case 3: /* ID2 */
 -        return 0xc0d1;
 +        val = 0xc0d1;
 +        break;
      case 4: /* Auto-neg advertisement */
 -        return s->advertise;
 +        val = s->advertise;
 +        break;
      case 5: /* Auto-neg Link Partner Ability */
 -        return 0x0f71;
 +        val = 0x0f71;
 +        break;
      case 6: /* Auto-neg Expansion */
 -        return 1;
 -        /* TODO 17, 18, 27, 29, 30, 31 */
 +        val = 1;
 +        break;
      case 29: /* Interrupt source. */
          val = s->ints;
          s->ints = 0;
          lan9118_phy_update_irq(s);
 -        return val;
 +        break;
      case 30: /* Interrupt mask */
 -        return s->int_mask;
 +        val = s->int_mask;
 +        break;
 +    case 17:
 +    case 18:
 +    case 27:
 +    case 31:
 +        qemu_log_mask(LOG_UNIMP, "%s: reg %d not implemented\n",
 +                      __func__, reg);
 +        val = 0;
 +        break;
      default:
 -        qemu_log_mask(LOG_GUEST_ERROR,
 -                      "lan9118_phy_read: PHY read reg %d\n", reg);
 -        return 0;
 +        qemu_log_mask(LOG_GUEST_ERROR, "%s: Bad address at offset %d\n",
 +                      __func__, reg);
 +        val = 0;
 +        break;
      }
 +
-     desc = simd_desc(vsz, vsz, zt | desc);
++    trace_lan9118_phy_read(val, reg);
-     t_desc = tcg_const_i32(desc);
++
-     t_pg = tcg_temp_new_ptr();
++    return val;
  }
  void lan9118_phy_write(Lan9118PhyState *s, int reg, uint16_t val)
  {
 +    trace_lan9118_phy_write(val, reg);
 +
      switch (reg) {
      case 0: /* Basic Control */
          if (val & 0x8000) {
              lan9118_phy_reset(s);
 -            break;
 -        }
 -        s->control = val & 0x7980;
 -        /* Complete autonegotiation immediately. */
 -        if (val & 0x1000) {
 -            s->status |= 0x0020;
 +        } else {
 +            s->control = val & 0x7980;
 +            /* Complete autonegotiation immediately. */
 +            if (val & 0x1000) {
 +                s->status |= 0x0020;
 +            }
          }
          break;
      case 4: /* Auto-neg advertisement */
          s->advertise = (val & 0x2d7f) | 0x80;
          break;
 -        /* TODO 17, 18, 27, 31 */
      case 30: /* Interrupt mask */
          s->int_mask = val & 0xff;
          lan9118_phy_update_irq(s);
          break;
 +    case 17:
 +    case 18:
 +    case 27:
 +    case 31:
 +        qemu_log_mask(LOG_UNIMP, "%s: reg %d not implemented\n",
 +                      __func__, reg);
 +        break;
      default:
 -        qemu_log_mask(LOG_GUEST_ERROR,
 -                      "lan9118_phy_write: PHY write reg %d = 0x%04x\n", reg, val);
 +        qemu_log_mask(LOG_GUEST_ERROR, "%s: Bad address at offset %d\n",
 +                      __func__, reg);
 +        break;
      }
  }
@@ -XXX,XX +XXX,XX @@ void lan9118_phy_update_link(Lan9118PhyState *s, bool link_down)
      /* Autonegotiation status mirrors link status. */
      if (link_down) {
 +        trace_lan9118_phy_update_link("down");
          s->status &= ~0x0024;
          s->ints |= PHY_INT_DOWN;
      } else {
 +        trace_lan9118_phy_update_link("up");
          s->status |= 0x0024;
          s->ints |= PHY_INT_ENERGYON;
          s->ints |= PHY_INT_AUTONEG_COMPLETE;
@@ -XXX,XX +XXX,XX @@ void lan9118_phy_update_link(Lan9118PhyState *s, bool link_down)
  void lan9118_phy_reset(Lan9118PhyState *s)
  {
 +    trace_lan9118_phy_reset();
 +
      s->control = 0x3000;
      s->status = 0x7809;
      s->advertise = 0x01e1;
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_lan9118_phy = {
      .version_id = 1,
      .minimum_version_id = 1,
      .fields = (const VMStateField[]) {
 -        VMSTATE_UINT16(control, Lan9118PhyState),
          VMSTATE_UINT16(status, Lan9118PhyState),
 +        VMSTATE_UINT16(control, Lan9118PhyState),
          VMSTATE_UINT16(advertise, Lan9118PhyState),
          VMSTATE_UINT16(ints, Lan9118PhyState),
          VMSTATE_UINT16(int_mask, Lan9118PhyState),
 diff --git a/hw/net/Kconfig b/hw/net/Kconfig
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/net/Kconfig
 +++ b/hw/net/Kconfig
@@ -XXX,XX +XXX,XX @@ config ALLWINNER_SUN8I_EMAC
  config IMX_FEC
      bool
 +    select LAN9118_PHY
  config CADENCE
      bool
 diff --git a/hw/net/trace-events b/hw/net/trace-events
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/net/trace-events
 +++ b/hw/net/trace-events
@@ -XXX,XX +XXX,XX @@ allwinner_sun8i_emac_set_link(bool active) "Set link: active=%u"
  allwinner_sun8i_emac_read(uint64_t offset, uint64_t val) "MMIO read: offset=0x%" PRIx64 " value=0x%" PRIx64
  allwinner_sun8i_emac_write(uint64_t offset, uint64_t val) "MMIO write: offset=0x%" PRIx64 " value=0x%" PRIx64
 +# lan9118_phy.c
 +lan9118_phy_read(uint16_t val, int reg) "[0x%02x] -> 0x%04" PRIx16
 +lan9118_phy_write(uint16_t val, int reg) "[0x%02x] <- 0x%04" PRIx16
 +lan9118_phy_update_link(const char *s) "%s"
 +lan9118_phy_reset(void) ""
 +
  # lance.c
  lance_mem_readw(uint64_t addr, uint32_t ret) "addr=0x%"PRIx64"val=0x%04x"
  lance_mem_writew(uint64_t addr, uint32_t val) "addr=0x%"PRIx64"val=0x%04x"
@@ -XXX,XX +XXX,XX @@ i82596_set_multicast(uint16_t count) "Added %d multicast entries"
  i82596_channel_attention(void *s) "%p: Received CHANNEL ATTENTION"
  # imx_fec.c
 -imx_phy_read(uint32_t val, int phy, int reg) "0x%04"PRIx32" <= phy[%d].reg[%d]"
  imx_phy_read_num(int phy, int configured) "read request from unconfigured phy %d (configured %d)"
 -imx_phy_write(uint32_t val, int phy, int reg) "0x%04"PRIx32" => phy[%d].reg[%d]"
  imx_phy_write_num(int phy, int configured) "write request to unconfigured phy %d (configured %d)"
 -imx_phy_update_link(const char *s) "%s"
 -imx_phy_reset(void) ""
  imx_fec_read_bd(uint64_t addr, int flags, int len, int data) "tx_bd 0x%"PRIx64" flags 0x%04x len %d data 0x%08x"
  imx_enet_read_bd(uint64_t addr, int flags, int len, int data, int options, int status) "tx_bd 0x%"PRIx64" flags 0x%04x len %d data 0x%08x option 0x%04x status 0x%04x"
  imx_eth_tx_bd_busy(void) "tx_bd ran out of descriptors to transmit"
 --
-.20.1
+.34.1

-[PULL 57/57] target/arm: Enable MTE
+[PULL 03/72] hw/net/lan9118_phy: Fix off-by-one error in MII_ANLPAR register
-From: Richard Henderson <richard.henderson@linaro.org>
+From: Bernhard Beschow <shentey@gmail.com>
-We now implement all of the components of MTE, without actually
+Turns 0x70 into 0xe0 (== 0x70 << 1) which adds the missing MII_ANLPAR_TX and
-supporting any tagged memory.  All MTE instructions will work,
+fixes the MSB of selector field to be zero, as specified in the datasheet.
 trivially, so we can enable support.
+Fixes: 2a424990170b "LAN9118 emulation"
+Signed-off-by: Bernhard Beschow <shentey@gmail.com>
+Tested-by: Guenter Roeck <linux@roeck-us.net>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241102125724.532843-4-shentey@gmail.com
 Message-id: 20200626033144.790098-46-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu64.c | 5 +++++
+ hw/net/lan9118_phy.c | 2 +-
-file changed, 5 insertions(+)
+file changed, 1 insertion(+), 1 deletion(-)
-diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
+diff --git a/hw/net/lan9118_phy.c b/hw/net/lan9118_phy.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu64.c
+--- a/hw/net/lan9118_phy.c
-+++ b/target/arm/cpu64.c
++++ b/hw/net/lan9118_phy.c
-@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
+@@ -XXX,XX +XXX,XX @@ uint16_t lan9118_phy_read(Lan9118PhyState *s, int reg)
+         val = s->advertise;
-         t = cpu->isar.id_aa64pfr1;
+         break;
-         t = FIELD_DP64(t, ID_AA64PFR1, BT, 1);
+     case 5: /* Auto-neg Link Partner Ability */
-+        /*
+-        val = 0x0f71;
-+         * Begin with full support for MTE; will be downgraded to MTE=1
++        val = 0x0fe1;
-+         * during realize if the board provides no tag memory.
+         break;
-+         */
+     case 6: /* Auto-neg Expansion */
-+        t = FIELD_DP64(t, ID_AA64PFR1, MTE, 2);
+         val = 1;
          cpu->isar.id_aa64pfr1 = t;
          t = cpu->isar.id_aa64mmfr1;
 --
-.20.1
+.34.1

-[PULL 24/57] target/arm: Implement the GMI instruction
+[PULL 04/72] hw/net/lan9118_phy: Reuse MII constants
-From: Richard Henderson <richard.henderson@linaro.org>
+From: Bernhard Beschow <shentey@gmail.com>
 Prefer named constants over magic values for better readability.
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Bernhard Beschow <shentey@gmail.com>
-Message-id: 20200626033144.790098-13-richard.henderson@linaro.org
+Tested-by: Guenter Roeck <linux@roeck-us.net>
 Message-id: 20241102125724.532843-5-shentey@gmail.com
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate-a64.c | 15 +++++++++++++++
+ include/hw/net/mii.h |  6 +++++
-file changed, 15 insertions(+)
+ hw/net/lan9118_phy.c | 63 ++++++++++++++++++++++++++++----------------
 files changed, 46 insertions(+), 23 deletions(-)
-diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
+diff --git a/include/hw/net/mii.h b/include/hw/net/mii.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-a64.c
+--- a/include/hw/net/mii.h
-+++ b/target/arm/translate-a64.c
++++ b/include/hw/net/mii.h
-@@ -XXX,XX +XXX,XX @@ static void disas_data_proc_2src(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@
-                                              cpu_reg_sp(s, rn));
+ #define MII_BMSR_JABBER     (1 << 1)  /* Jabber detected */
  #define MII_BMSR_EXTCAP     (1 << 0)  /* Ext-reg capability */
 +#define MII_ANAR_RFAULT     (1 << 13) /* Say we can detect faults */
  #define MII_ANAR_PAUSE_ASYM (1 << 11) /* Try for asymmetric pause */
  #define MII_ANAR_PAUSE      (1 << 10) /* Try for pause */
  #define MII_ANAR_TXFD       (1 << 8)
@@ -XXX,XX +XXX,XX @@
  #define MII_ANAR_10FD       (1 << 6)
  #define MII_ANAR_10         (1 << 5)
  #define MII_ANAR_CSMACD     (1 << 0)
 +#define MII_ANAR_SELECT     (0x001f)  /* Selector bits */
  #define MII_ANLPAR_ACK      (1 << 14)
  #define MII_ANLPAR_PAUSEASY (1 << 11) /* can pause asymmetrically */
@@ -XXX,XX +XXX,XX @@
  #define RTL8201CP_PHYID1    0x0000
  #define RTL8201CP_PHYID2    0x8201
 +/* SMSC LAN9118 */
 +#define SMSCLAN9118_PHYID1  0x0007
 +#define SMSCLAN9118_PHYID2  0xc0d1
 +
  /* RealTek 8211E */
  #define RTL8211E_PHYID1     0x001c
  #define RTL8211E_PHYID2     0xc915
 diff --git a/hw/net/lan9118_phy.c b/hw/net/lan9118_phy.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/net/lan9118_phy.c
 +++ b/hw/net/lan9118_phy.c
@@ -XXX,XX +XXX,XX @@
  #include "qemu/osdep.h"
  #include "hw/net/lan9118_phy.h"
 +#include "hw/net/mii.h"
  #include "hw/irq.h"
  #include "hw/resettable.h"
  #include "migration/vmstate.h"
@@ -XXX,XX +XXX,XX @@ uint16_t lan9118_phy_read(Lan9118PhyState *s, int reg)
      uint16_t val;
      switch (reg) {
 -    case 0: /* Basic Control */
 +    case MII_BMCR:
          val = s->control;
          break;
 -    case 1: /* Basic Status */
 +    case MII_BMSR:
          val = s->status;
          break;
 -    case 2: /* ID1 */
 -        val = 0x0007;
 +    case MII_PHYID1:
 +        val = SMSCLAN9118_PHYID1;
          break;
 -    case 3: /* ID2 */
 -        val = 0xc0d1;
 +    case MII_PHYID2:
 +        val = SMSCLAN9118_PHYID2;
          break;
 -    case 4: /* Auto-neg advertisement */
 +    case MII_ANAR:
          val = s->advertise;
          break;
 -    case 5: /* Auto-neg Link Partner Ability */
 -        val = 0x0fe1;
 +    case MII_ANLPAR:
 +        val = MII_ANLPAR_PAUSEASY | MII_ANLPAR_PAUSE | MII_ANLPAR_T4 |
 +              MII_ANLPAR_TXFD | MII_ANLPAR_TX | MII_ANLPAR_10FD |
 +              MII_ANLPAR_10 | MII_ANLPAR_CSMACD;
          break;
 -    case 6: /* Auto-neg Expansion */
 -        val = 1;
 +    case MII_ANER:
 +        val = MII_ANER_NWAY;
          break;
      case 29: /* Interrupt source. */
          val = s->ints;
@@ -XXX,XX +XXX,XX @@ void lan9118_phy_write(Lan9118PhyState *s, int reg, uint16_t val)
      trace_lan9118_phy_write(val, reg);
      switch (reg) {
 -    case 0: /* Basic Control */
 -        if (val & 0x8000) {
 +    case MII_BMCR:
 +        if (val & MII_BMCR_RESET) {
              lan9118_phy_reset(s);
          } else {
 -            s->control = val & 0x7980;
 +            s->control = val & (MII_BMCR_LOOPBACK | MII_BMCR_SPEED100 |
 +                                MII_BMCR_AUTOEN | MII_BMCR_PDOWN | MII_BMCR_FD |
 +                                MII_BMCR_CTST);
              /* Complete autonegotiation immediately. */
 -            if (val & 0x1000) {
 -                s->status |= 0x0020;
 +            if (val & MII_BMCR_AUTOEN) {
 +                s->status |= MII_BMSR_AN_COMP;
              }
          }
          break;
-+    case 5: /* GMI */
+-    case 4: /* Auto-neg advertisement */
-+        if (sf == 0 || !dc_isar_feature(aa64_mte_insn_reg, s)) {
+-        s->advertise = (val & 0x2d7f) | 0x80;
-+            goto do_unallocated;
++    case MII_ANAR:
-+        } else {
++        s->advertise = (val & (MII_ANAR_RFAULT | MII_ANAR_PAUSE_ASYM |
-+            TCGv_i64 t1 = tcg_const_i64(1);
++                               MII_ANAR_PAUSE | MII_ANAR_10FD | MII_ANAR_10 |
-+            TCGv_i64 t2 = tcg_temp_new_i64();
++                               MII_ANAR_SELECT))
-+
++                     | MII_ANAR_TX;
 +            tcg_gen_extract_i64(t2, cpu_reg_sp(s, rn), 56, 4);
 +            tcg_gen_shl_i64(t1, t1, t2);
 +            tcg_gen_or_i64(cpu_reg(s, rd), cpu_reg(s, rm), t1);
 +
 +            tcg_temp_free_i64(t1);
 +            tcg_temp_free_i64(t2);
 +        }
 +        break;
      case 8: /* LSLV */
          handle_shift_reg(s, A64_SHIFT_TYPE_LSL, sf, rm, rn, rd);
          break;
+     case 30: /* Interrupt mask */
+         s->int_mask = val & 0xff;
+@@ -XXX,XX +XXX,XX @@ void lan9118_phy_update_link(Lan9118PhyState *s, bool link_down)
+     /* Autonegotiation status mirrors link status. */
+     if (link_down) {
+         trace_lan9118_phy_update_link("down");
+-        s->status &= ~0x0024;
++        s->status &= ~(MII_BMSR_AN_COMP | MII_BMSR_LINK_ST);
+         s->ints |= PHY_INT_DOWN;
+     } else {
+         trace_lan9118_phy_update_link("up");
+-        s->status |= 0x0024;
++        s->status |= MII_BMSR_AN_COMP | MII_BMSR_LINK_ST;
+         s->ints |= PHY_INT_ENERGYON;
+         s->ints |= PHY_INT_AUTONEG_COMPLETE;
+     }
+@@ -XXX,XX +XXX,XX @@ void lan9118_phy_reset(Lan9118PhyState *s)
+ {
+     trace_lan9118_phy_reset();
+-    s->control = 0x3000;
+-    s->status = 0x7809;
+-    s->advertise = 0x01e1;
++    s->control = MII_BMCR_AUTOEN | MII_BMCR_SPEED100;
++    s->status = MII_BMSR_100TX_FD
++                | MII_BMSR_100TX_HD
++                | MII_BMSR_10T_FD
++                | MII_BMSR_10T_HD
++                | MII_BMSR_AUTONEG
++                | MII_BMSR_EXTCAP;
++    s->advertise = MII_ANAR_TXFD
++                   | MII_ANAR_TX
++                   | MII_ANAR_10FD
++                   | MII_ANAR_10
++                   | MII_ANAR_CSMACD;
+     s->int_mask = 0;
+     s->ints = 0;
+     lan9118_phy_update_link(s, s->link_down);
 --
-.20.1
+.34.1

-[PULL 53/57] target/arm: Always pass cacheattr to get_phys_addr
+[PULL 05/72] hw/net/lan9118_phy: Add missing 100 mbps full duplex advertisement
-From: Richard Henderson <richard.henderson@linaro.org>
+From: Bernhard Beschow <shentey@gmail.com>
-We need to check the memattr of a page in order to determine
+The real device advertises this mode and the device model already advertises
-whether it is Tagged for MTE.  Between Stage1 and Stage2,
+mbps half duplex and 10 mbps full+half duplex. So advertise this mode to
-this becomes simpler if we always collect this data, instead
+make the model more realistic.
 of occasionally being presented with NULL.
 Use the nonnull attribute to allow the compiler to check that
 all pointer arguments are non-null.
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Bernhard Beschow <shentey@gmail.com>
-Message-id: 20200626033144.790098-42-richard.henderson@linaro.org
+Tested-by: Guenter Roeck <linux@roeck-us.net>
 Message-id: 20241102125724.532843-6-shentey@gmail.com
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/internals.h  |  3 ++-
+ hw/net/lan9118_phy.c | 4 ++--
- target/arm/helper.c     | 60 ++++++++++++++++++++---------------------
+file changed, 2 insertions(+), 2 deletions(-)
  target/arm/m_helper.c   | 11 +++++---
  target/arm/tlb_helper.c |  4 ++-
 files changed, 42 insertions(+), 36 deletions(-)
-diff --git a/target/arm/internals.h b/target/arm/internals.h
+diff --git a/hw/net/lan9118_phy.c b/hw/net/lan9118_phy.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/internals.h
+--- a/hw/net/lan9118_phy.c
-+++ b/target/arm/internals.h
++++ b/hw/net/lan9118_phy.c
-@@ -XXX,XX +XXX,XX @@ bool get_phys_addr(CPUARMState *env, target_ulong address,
+@@ -XXX,XX +XXX,XX @@ void lan9118_phy_write(Lan9118PhyState *s, int reg, uint16_t val)
-                    MMUAccessType access_type, ARMMMUIdx mmu_idx,
+         break;
-                    hwaddr *phys_ptr, MemTxAttrs *attrs, int *prot,
+     case MII_ANAR:
-                    target_ulong *page_size,
+         s->advertise = (val & (MII_ANAR_RFAULT | MII_ANAR_PAUSE_ASYM |
--                   ARMMMUFaultInfo *fi, ARMCacheAttrs *cacheattrs);
+-                               MII_ANAR_PAUSE | MII_ANAR_10FD | MII_ANAR_10 |
-+                   ARMMMUFaultInfo *fi, ARMCacheAttrs *cacheattrs)
+-                               MII_ANAR_SELECT))
-+    __attribute__((nonnull));
++                               MII_ANAR_PAUSE | MII_ANAR_TXFD | MII_ANAR_10FD |
++                               MII_ANAR_10 | MII_ANAR_SELECT))
- void arm_log_exception(int idx);
+                      | MII_ANAR_TX;
+         break;
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+     case 30: /* Interrupt mask */
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static bool get_phys_addr_lpae(CPUARMState *env, target_ulong address,
                                 bool s1_is_el0,
                                 hwaddr *phys_ptr, MemTxAttrs *txattrs, int *prot,
                                 target_ulong *page_size_ptr,
 -                               ARMMMUFaultInfo *fi, ARMCacheAttrs *cacheattrs);
 +                               ARMMMUFaultInfo *fi, ARMCacheAttrs *cacheattrs)
 +    __attribute__((nonnull));
  #endif
  static void switch_mode(CPUARMState *env, int mode);
@@ -XXX,XX +XXX,XX @@ static bool get_phys_addr_lpae(CPUARMState *env, target_ulong address,
          arm_tlb_bti_gp(txattrs) = true;
      }
 -    if (cacheattrs != NULL) {
 -        if (mmu_idx == ARMMMUIdx_Stage2) {
 -            cacheattrs->attrs = convert_stage2_attrs(env,
 -                                                     extract32(attrs, 0, 4));
 -        } else {
 -            /* Index into MAIR registers for cache attributes */
 -            uint8_t attrindx = extract32(attrs, 0, 3);
 -            uint64_t mair = env->cp15.mair_el[regime_el(env, mmu_idx)];
 -            assert(attrindx <= 7);
 -            cacheattrs->attrs = extract64(mair, attrindx * 8, 8);
 -        }
 -        cacheattrs->shareability = extract32(attrs, 6, 2);
 +    if (mmu_idx == ARMMMUIdx_Stage2) {
 +        cacheattrs->attrs = convert_stage2_attrs(env, extract32(attrs, 0, 4));
 +    } else {
 +        /* Index into MAIR registers for cache attributes */
 +        uint8_t attrindx = extract32(attrs, 0, 3);
 +        uint64_t mair = env->cp15.mair_el[regime_el(env, mmu_idx)];
 +        assert(attrindx <= 7);
 +        cacheattrs->attrs = extract64(mair, attrindx * 8, 8);
      }
 +    cacheattrs->shareability = extract32(attrs, 6, 2);
      *phys_ptr = descaddr;
      *page_size_ptr = page_size;
@@ -XXX,XX +XXX,XX @@ bool get_phys_addr(CPUARMState *env, target_ulong address,
              ret = get_phys_addr_lpae(env, ipa, access_type, ARMMMUIdx_Stage2,
                                       mmu_idx == ARMMMUIdx_E10_0,
                                       phys_ptr, attrs, &s2_prot,
 -                                     page_size, fi,
 -                                     cacheattrs != NULL ? &cacheattrs2 : NULL);
 +                                     page_size, fi, &cacheattrs2);
              fi->s2addr = ipa;
              /* Combine the S1 and S2 perms.  */
              *prot &= s2_prot;
 -            /* Combine the S1 and S2 cache attributes, if needed */
 -            if (!ret && cacheattrs != NULL) {
 -                if (env->cp15.hcr_el2 & HCR_DC) {
 -                    /*
 -                     * HCR.DC forces the first stage attributes to
 -                     *  Normal Non-Shareable,
 -                     *  Inner Write-Back Read-Allocate Write-Allocate,
 -                     *  Outer Write-Back Read-Allocate Write-Allocate.
 -                     */
 -                    cacheattrs->attrs = 0xff;
 -                    cacheattrs->shareability = 0;
 -                }
 -                *cacheattrs = combine_cacheattrs(*cacheattrs, cacheattrs2);
 +            /* If S2 fails, return early.  */
 +            if (ret) {
 +                return ret;
              }
 -            return ret;
 +            /* Combine the S1 and S2 cache attributes. */
 +            if (env->cp15.hcr_el2 & HCR_DC) {
 +                /*
 +                 * HCR.DC forces the first stage attributes to
 +                 *  Normal Non-Shareable,
 +                 *  Inner Write-Back Read-Allocate Write-Allocate,
 +                 *  Outer Write-Back Read-Allocate Write-Allocate.
 +                 */
 +                cacheattrs->attrs = 0xff;
 +                cacheattrs->shareability = 0;
 +            }
 +            *cacheattrs = combine_cacheattrs(*cacheattrs, cacheattrs2);
 +            return 0;
          } else {
              /*
               * For non-EL2 CPUs a stage1+stage2 translation is just stage 1.
@@ -XXX,XX +XXX,XX @@ hwaddr arm_cpu_get_phys_page_attrs_debug(CPUState *cs, vaddr addr,
      bool ret;
      ARMMMUFaultInfo fi = {};
      ARMMMUIdx mmu_idx = arm_mmu_idx(env);
 +    ARMCacheAttrs cacheattrs = {};
      *attrs = (MemTxAttrs) {};
      ret = get_phys_addr(env, addr, 0, mmu_idx, &phys_addr,
 -                        attrs, &prot, &page_size, &fi, NULL);
 +                        attrs, &prot, &page_size, &fi, &cacheattrs);
      if (ret) {
          return -1;
 diff --git a/target/arm/m_helper.c b/target/arm/m_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/m_helper.c
 +++ b/target/arm/m_helper.c
@@ -XXX,XX +XXX,XX @@ static bool v7m_stack_write(ARMCPU *cpu, uint32_t addr, uint32_t value,
      hwaddr physaddr;
      int prot;
      ARMMMUFaultInfo fi = {};
 +    ARMCacheAttrs cacheattrs = {};
      bool secure = mmu_idx & ARM_MMU_IDX_M_S;
      int exc;
      bool exc_secure;
      if (get_phys_addr(env, addr, MMU_DATA_STORE, mmu_idx, &physaddr,
 -                      &attrs, &prot, &page_size, &fi, NULL)) {
 +                      &attrs, &prot, &page_size, &fi, &cacheattrs)) {
          /* MPU/SAU lookup failed */
          if (fi.type == ARMFault_QEMU_SFault) {
              if (mode == STACK_LAZYFP) {
@@ -XXX,XX +XXX,XX @@ static bool v7m_stack_read(ARMCPU *cpu, uint32_t *dest, uint32_t addr,
      hwaddr physaddr;
      int prot;
      ARMMMUFaultInfo fi = {};
 +    ARMCacheAttrs cacheattrs = {};
      bool secure = mmu_idx & ARM_MMU_IDX_M_S;
      int exc;
      bool exc_secure;
      uint32_t value;
      if (get_phys_addr(env, addr, MMU_DATA_LOAD, mmu_idx, &physaddr,
 -                      &attrs, &prot, &page_size, &fi, NULL)) {
 +                      &attrs, &prot, &page_size, &fi, &cacheattrs)) {
          /* MPU/SAU lookup failed */
          if (fi.type == ARMFault_QEMU_SFault) {
              qemu_log_mask(CPU_LOG_INT,
@@ -XXX,XX +XXX,XX @@ static bool v7m_read_half_insn(ARMCPU *cpu, ARMMMUIdx mmu_idx,
      V8M_SAttributes sattrs = {};
      MemTxAttrs attrs = {};
      ARMMMUFaultInfo fi = {};
 +    ARMCacheAttrs cacheattrs = {};
      MemTxResult txres;
      target_ulong page_size;
      hwaddr physaddr;
@@ -XXX,XX +XXX,XX @@ static bool v7m_read_half_insn(ARMCPU *cpu, ARMMMUIdx mmu_idx,
                        "...really SecureFault with SFSR.INVEP\n");
          return false;
      }
 -    if (get_phys_addr(env, addr, MMU_INST_FETCH, mmu_idx,
 -                      &physaddr, &attrs, &prot, &page_size, &fi, NULL)) {
 +    if (get_phys_addr(env, addr, MMU_INST_FETCH, mmu_idx, &physaddr,
 +                      &attrs, &prot, &page_size, &fi, &cacheattrs)) {
          /* the MPU lookup failed */
          env->v7m.cfsr[env->v7m.secure] |= R_V7M_CFSR_IACCVIOL_MASK;
          armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_MEM, env->v7m.secure);
 diff --git a/target/arm/tlb_helper.c b/target/arm/tlb_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/tlb_helper.c
 +++ b/target/arm/tlb_helper.c
@@ -XXX,XX +XXX,XX @@ bool arm_cpu_tlb_fill(CPUState *cs, vaddr address, int size,
      int prot, ret;
      MemTxAttrs attrs = {};
      ARMMMUFaultInfo fi = {};
 +    ARMCacheAttrs cacheattrs = {};
      /*
       * Walk the page table and (if the mapping exists) add the page
@@ -XXX,XX +XXX,XX @@ bool arm_cpu_tlb_fill(CPUState *cs, vaddr address, int size,
       */
      ret = get_phys_addr(&cpu->env, address, access_type,
                          core_to_arm_mmu_idx(&cpu->env, mmu_idx),
 -                        &phys_addr, &attrs, &prot, &page_size, &fi, NULL);
 +                        &phys_addr, &attrs, &prot, &page_size,
 +                        &fi, &cacheattrs);
      if (likely(!ret)) {
          /*
           * Map a single [sub]page. Regions smaller than our declared
 --
-.20.1
+.34.1

-[PULL 31/57] target/arm: Implement the LDGM, STGM, STZGM instructions
+[PULL 06/72] fpu: handle raising Invalid for infzero in pick_nan_muladd
-From: Richard Henderson <richard.henderson@linaro.org>
+For IEEE fused multiply-add, the (0 * inf) + NaN case should raise
 Invalid for the multiplication of 0 by infinity.  Currently we handle
 this in the per-architecture ifdef ladder in pickNaNMulAdd().
 However, since this isn't really architecture specific we can hoist
 it up to the generic code.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+For the cases where the infzero test in pickNaNMulAdd was
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+returning 2, we can delete the check entirely and allow the
-Message-id: 20200626033144.790098-20-richard.henderson@linaro.org
+code to fall into the normal pick-a-NaN handling, because this
 will return 2 anyway (input 'c' being the only NaN in this case).
 For the cases where infzero was returning 3 to indicate "return
 the default NaN", we must retain that "return 3".
 For Arm, this looks like it might be a behaviour change because we
 used to set float_flag_invalid | float_flag_invalid_imz only if C is
 a quiet NaN.  However, it is not, because Arm target code never looks
 at float_flag_invalid_imz, and for the (0 * inf) + SNaN case we
 already raised float_flag_invalid via the "abc_mask &
 float_cmask_snan" check in pick_nan_muladd.
 For any target architecture using the "default implementation" at the
 bottom of the ifdef, this is a behaviour change but will be fixing a
 bug (where we failed to raise the Invalid exception for (0 * inf +
 QNaN).  The architectures using the default case are:
  * hppa
  * i386
  * sh4
  * tricore
 The x86, Tricore and SH4 CPU architecture manuals are clear that this
 should have raised Invalid; HPPA is a bit vaguer but still seems
 clear enough.
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-2-peter.maydell@linaro.org
 ---
- target/arm/helper-a64.h    |  3 ++
+ fpu/softfloat-parts.c.inc      | 13 +++++++------
- target/arm/translate.h     |  2 +
+ fpu/softfloat-specialize.c.inc | 29 +----------------------------
- target/arm/mte_helper.c    | 84 ++++++++++++++++++++++++++++++++++++++
+files changed, 8 insertions(+), 34 deletions(-)
  target/arm/translate-a64.c | 72 ++++++++++++++++++++++++++++----
 files changed, 153 insertions(+), 8 deletions(-)
-diff --git a/target/arm/helper-a64.h b/target/arm/helper-a64.h
+diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-a64.h
+--- a/fpu/softfloat-parts.c.inc
-+++ b/target/arm/helper-a64.h
++++ b/fpu/softfloat-parts.c.inc
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_2(stg_stub, TCG_CALL_NO_WG, void, env, i64)
+@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
- DEF_HELPER_FLAGS_3(st2g, TCG_CALL_NO_WG, void, env, i64, i64)
+                                             int ab_mask, int abc_mask)
- DEF_HELPER_FLAGS_3(st2g_parallel, TCG_CALL_NO_WG, void, env, i64, i64)
+ {
- DEF_HELPER_FLAGS_2(st2g_stub, TCG_CALL_NO_WG, void, env, i64)
+     int which;
-+DEF_HELPER_FLAGS_2(ldgm, TCG_CALL_NO_WG, i64, env, i64)
++    bool infzero = (ab_mask == float_cmask_infzero);
-+DEF_HELPER_FLAGS_3(stgm, TCG_CALL_NO_WG, void, env, i64, i64)
-+DEF_HELPER_FLAGS_3(stzgm_tags, TCG_CALL_NO_WG, void, env, i64, i64)
+     if (unlikely(abc_mask & float_cmask_snan)) {
-diff --git a/target/arm/translate.h b/target/arm/translate.h
+         float_raise(float_flag_invalid | float_flag_invalid_snan, s);
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.h
 +++ b/target/arm/translate.h
@@ -XXX,XX +XXX,XX @@ typedef struct DisasContext {
       *  < 0, set by the current instruction.
       */
      int8_t btype;
 +    /* A copy of cpu->dcz_blocksize. */
 +    uint8_t dcz_blocksize;
      /* True if this page is guarded.  */
      bool guarded_page;
      /* Bottom two bits of XScale c15_cpar coprocessor access control reg */
 diff --git a/target/arm/mte_helper.c b/target/arm/mte_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/mte_helper.c
 +++ b/target/arm/mte_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(st2g_stub)(CPUARMState *env, uint64_t ptr)
          probe_write(env, ptr + TAG_GRANULE, TAG_GRANULE, mmu_idx, ra);
      }
- }
-+
+-    which = pickNaNMulAdd(a->cls, b->cls, c->cls,
-+#define LDGM_STGM_SIZE  (4 << GMID_EL1_BS)
+-                          ab_mask == float_cmask_infzero, s);
-+
++    if (infzero) {
-+uint64_t HELPER(ldgm)(CPUARMState *env, uint64_t ptr)
++        /* This is (0 * inf) + NaN or (inf * 0) + NaN */
-+{
++        float_raise(float_flag_invalid | float_flag_invalid_imz, s);
 +    int mmu_idx = cpu_mmu_index(env, false);
 +    uintptr_t ra = GETPC();
 +    void *tag_mem;
 +
 +    ptr = QEMU_ALIGN_DOWN(ptr, LDGM_STGM_SIZE);
 +
 +    /* Trap if accessing an invalid page.  */
 +    tag_mem = allocation_tag_mem(env, mmu_idx, ptr, MMU_DATA_LOAD,
 +                                 LDGM_STGM_SIZE, MMU_DATA_LOAD,
 +                                 LDGM_STGM_SIZE / (2 * TAG_GRANULE), ra);
 +
 +    /* The tag is squashed to zero if the page does not support tags.  */
 +    if (!tag_mem) {
 +        return 0;
 +    }
 +
-+    QEMU_BUILD_BUG_ON(GMID_EL1_BS != 6);
++    which = pickNaNMulAdd(a->cls, b->cls, c->cls, infzero, s);
-+    /*
-+     * We are loading 64-bits worth of tags.  The ordering of elements
+     if (s->default_nan_mode || which == 3) {
-+     * within the word corresponds to a 64-bit little-endian operation.
+-        /*
-+     */
+-         * Note that this check is after pickNaNMulAdd so that function
-+    return ldq_le_p(tag_mem);
+-         * has an opportunity to set the Invalid flag for infzero.
-+}
+-         */
          parts_default_nan(a, s);
          return a;
      }
 diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 index XXXXXXX..XXXXXXX 100644
 --- a/fpu/softfloat-specialize.c.inc
 +++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
       * the default NaN
       */
      if (infzero && is_qnan(c_cls)) {
 -        float_raise(float_flag_invalid | float_flag_invalid_imz, status);
          return 3;
      }
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
           * case sets InvalidOp and returns the default NaN
           */
          if (infzero) {
 -            float_raise(float_flag_invalid | float_flag_invalid_imz, status);
              return 3;
          }
          /* Prefer sNaN over qNaN, in the a, b, c order. */
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
           * For MIPS systems that conform to IEEE754-2008, the (inf,zero,nan)
           * case sets InvalidOp and returns the input value 'c'
           */
 -        if (infzero) {
 -            float_raise(float_flag_invalid | float_flag_invalid_imz, status);
 -            return 2;
 -        }
          /* Prefer sNaN over qNaN, in the c, a, b order. */
          if (is_snan(c_cls)) {
              return 2;
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
       * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
       * case sets InvalidOp and returns the input value 'c'
       */
 -    if (infzero) {
 -        float_raise(float_flag_invalid | float_flag_invalid_imz, status);
 -        return 2;
 -    }
 +
-+void HELPER(stgm)(CPUARMState *env, uint64_t ptr, uint64_t val)
+     /* Prefer sNaN over qNaN, in the c, a, b order. */
-+{
+     if (is_snan(c_cls)) {
-+    int mmu_idx = cpu_mmu_index(env, false);
+         return 2;
-+    uintptr_t ra = GETPC();
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
-+    void *tag_mem;
+      * to return an input NaN if we have one (ie c) rather than generating
-+
+      * a default NaN
-+    ptr = QEMU_ALIGN_DOWN(ptr, LDGM_STGM_SIZE);
+      */
-+
+-    if (infzero) {
-+    /* Trap if accessing an invalid page.  */
+-        float_raise(float_flag_invalid | float_flag_invalid_imz, status);
-+    tag_mem = allocation_tag_mem(env, mmu_idx, ptr, MMU_DATA_STORE,
+-        return 2;
-+                                 LDGM_STGM_SIZE, MMU_DATA_LOAD,
+-    }
-+                                 LDGM_STGM_SIZE / (2 * TAG_GRANULE), ra);
-+
+     /* If fRA is a NaN return it; otherwise if fRB is a NaN return it;
-+    /*
+      * otherwise return fRC. Note that muladd on PPC is (fRA * fRC) + frB
-+     * Tag store only happens if the page support tags,
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
-+     * and if the OS has enabled access to the tags.
+         return 1;
 +     */
 +    if (!tag_mem) {
 +        return;
 +    }
 +
 +    QEMU_BUILD_BUG_ON(GMID_EL1_BS != 6);
 +    /*
 +     * We are storing 64-bits worth of tags.  The ordering of elements
 +     * within the word corresponds to a 64-bit little-endian operation.
 +     */
 +    stq_le_p(tag_mem, val);
 +}
 +
 +void HELPER(stzgm_tags)(CPUARMState *env, uint64_t ptr, uint64_t val)
 +{
 +    uintptr_t ra = GETPC();
 +    int mmu_idx = cpu_mmu_index(env, false);
 +    int log2_dcz_bytes, log2_tag_bytes;
 +    intptr_t dcz_bytes, tag_bytes;
 +    uint8_t *mem;
 +
 +    /*
 +     * In arm_cpu_realizefn, we assert that dcz > LOG2_TAG_GRANULE+1,
 +     * i.e. 32 bytes, which is an unreasonably small dcz anyway,
 +     * to make sure that we can access one complete tag byte here.
 +     */
 +    log2_dcz_bytes = env_archcpu(env)->dcz_blocksize + 2;
 +    log2_tag_bytes = log2_dcz_bytes - (LOG2_TAG_GRANULE + 1);
 +    dcz_bytes = (intptr_t)1 << log2_dcz_bytes;
 +    tag_bytes = (intptr_t)1 << log2_tag_bytes;
 +    ptr &= -dcz_bytes;
 +
 +    mem = allocation_tag_mem(env, mmu_idx, ptr, MMU_DATA_STORE, dcz_bytes,
 +                             MMU_DATA_STORE, tag_bytes, ra);
 +    if (mem) {
 +        int tag_pair = (val & 0xf) * 0x11;
 +        memset(mem, tag_pair, tag_bytes);
 +    }
 +}
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_tag(DisasContext *s, uint32_t insn)
      uint64_t offset = sextract64(insn, 12, 9) << LOG2_TAG_GRANULE;
      int op2 = extract32(insn, 10, 2);
      int op1 = extract32(insn, 22, 2);
 -    bool is_load = false, is_pair = false, is_zero = false;
 +    bool is_load = false, is_pair = false, is_zero = false, is_mult = false;
      int index = 0;
      TCGv_i64 addr, clean_addr, tcg_rt;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_tag(DisasContext *s, uint32_t insn)
          if (op2 != 0) {
              /* STG */
              index = op2 - 2;
 -            break;
 +        } else {
 +            /* STZGM */
 +            if (s->current_el == 0 || offset != 0) {
 +                goto do_unallocated;
 +            }
 +            is_mult = is_zero = true;
          }
 -        goto do_unallocated;
 +        break;
      case 1:
          if (op2 != 0) {
              /* STZG */
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_tag(DisasContext *s, uint32_t insn)
              /* ST2G */
              is_pair = true;
              index = op2 - 2;
 -            break;
 +        } else {
 +            /* STGM */
 +            if (s->current_el == 0 || offset != 0) {
 +                goto do_unallocated;
 +            }
 +            is_mult = true;
          }
 -        goto do_unallocated;
 +        break;
      case 3:
          if (op2 != 0) {
              /* STZ2G */
              is_pair = is_zero = true;
              index = op2 - 2;
 -            break;
 +        } else {
 +            /* LDGM */
 +            if (s->current_el == 0 || offset != 0) {
 +                goto do_unallocated;
 +            }
 +            is_mult = is_load = true;
          }
 -        goto do_unallocated;
 +        break;
      default:
      do_unallocated:
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_tag(DisasContext *s, uint32_t insn)
          return;
      }
+ #elif defined(TARGET_RISCV)
--    if (!dc_isar_feature(aa64_mte_insn_reg, s)) {
+-    /* For RISC-V, InvalidOp is set when multiplicands are Inf and zero */
-+    if (is_mult
+-    if (infzero) {
-+        ? !dc_isar_feature(aa64_mte, s)
+-        float_raise(float_flag_invalid | float_flag_invalid_imz, status);
-+        : !dc_isar_feature(aa64_mte_insn_reg, s)) {
+-    }
-         goto do_unallocated;
+     return 3; /* default NaN */
  #elif defined(TARGET_S390X)
      if (infzero) {
 -        float_raise(float_flag_invalid | float_flag_invalid_imz, status);
          return 3;
      }
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_tag(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
-         tcg_gen_addi_i64(addr, addr, offset);
+         return 2;
      }
+ #elif defined(TARGET_SPARC)
-+    if (is_mult) {
+-    /* For (inf,0,nan) return c. */
-+        tcg_rt = cpu_reg(s, rt);
+-    if (infzero) {
-+
+-        float_raise(float_flag_invalid | float_flag_invalid_imz, status);
-+        if (is_zero) {
+-        return 2;
-+            int size = 4 << s->dcz_blocksize;
+-    }
-+
+     /* Prefer SNaN over QNaN, order C, B, A. */
-+            if (s->ata) {
+     if (is_snan(c_cls)) {
-+                gen_helper_stzgm_tags(cpu_env, addr, tcg_rt);
+         return 2;
-+            }
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
-+            /*
+      * For Xtensa, the (inf,zero,nan) case sets InvalidOp and returns
-+             * The non-tags portion of STZGM is mostly like DC_ZVA,
+      * an input NaN if we have one (ie c).
-+             * except the alignment happens before the access.
+      */
-+             */
+-    if (infzero) {
-+            clean_addr = clean_data_tbi(s, addr);
+-        float_raise(float_flag_invalid | float_flag_invalid_imz, status);
-+            tcg_gen_andi_i64(clean_addr, clean_addr, -size);
+-        return 2;
-+            gen_helper_dc_zva(cpu_env, clean_addr);
+-    }
-+        } else if (s->ata) {
+     if (status->use_first_nan) {
-+            if (is_load) {
+         if (is_nan(a_cls)) {
-+                gen_helper_ldgm(tcg_rt, cpu_env, addr);
+             return 0;
 +            } else {
 +                gen_helper_stgm(cpu_env, addr, tcg_rt);
 +            }
 +        } else {
 +            MMUAccessType acc = is_load ? MMU_DATA_LOAD : MMU_DATA_STORE;
 +            int size = 4 << GMID_EL1_BS;
 +
 +            clean_addr = clean_data_tbi(s, addr);
 +            tcg_gen_andi_i64(clean_addr, clean_addr, -size);
 +            gen_probe_access(s, clean_addr, acc, size);
 +
 +            if (is_load) {
 +                /* The result tags are zeros.  */
 +                tcg_gen_movi_i64(tcg_rt, 0);
 +            }
 +        }
 +        return;
 +    }
 +
      if (is_load) {
          tcg_gen_andi_i64(addr, addr, -TAG_GRANULE);
          tcg_rt = cpu_reg(s, rt);
@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_init_disas_context(DisasContextBase *dcbase,
      dc->vec_stride = 0;
      dc->cp_regs = arm_cpu->cp_regs;
      dc->features = env->features;
 +    dc->dcz_blocksize = arm_cpu->dcz_blocksize;
      /* Single step state. The code-generation logic here is:
       *  SS_ACTIVE == 0:
 --
-.20.1
+.34.1

-[PULL 52/57] target/arm: Set PSTATE.TCO on exception entry
+[PULL 07/72] fpu: Check for default_nan_mode before calling pickNaNMulAdd
-From: Richard Henderson <richard.henderson@linaro.org>
+If the target sets default_nan_mode then we're always going to return
 the default NaN, and pickNaNMulAdd() no longer has any side effects.
 For consistency with pickNaN(), check for default_nan_mode before
 calling pickNaNMulAdd().
-D1.10 specifies that exception handlers begin with tag checks overridden.
+When we convert pickNaNMulAdd() to allow runtime selection of the NaN
 propagation rule, this means we won't have to make the targets which
 use default_nan_mode also set a propagation rule.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Since RiscV always uses default_nan_mode, this allows us to remove
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+its ifdef case from pickNaNMulAdd().
-Message-id: 20200626033144.790098-41-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-3-peter.maydell@linaro.org
 ---
- target/arm/helper.c | 3 +++
+ fpu/softfloat-parts.c.inc      | 8 ++++++--
-file changed, 3 insertions(+)
+ fpu/softfloat-specialize.c.inc | 9 +++++++--
 files changed, 13 insertions(+), 4 deletions(-)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/fpu/softfloat-parts.c.inc
-+++ b/target/arm/helper.c
++++ b/fpu/softfloat-parts.c.inc
-@@ -XXX,XX +XXX,XX @@ static void arm_cpu_do_interrupt_aarch64(CPUState *cs)
+@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
-             break;
+         float_raise(float_flag_invalid | float_flag_invalid_imz, s);
          }
      }
-+    if (cpu_isar_feature(aa64_mte, cpu)) {
-+        new_mode |= PSTATE_TCO;
+-    which = pickNaNMulAdd(a->cls, b->cls, c->cls, infzero, s);
 +    if (s->default_nan_mode) {
 +        which = 3;
 +    } else {
 +        which = pickNaNMulAdd(a->cls, b->cls, c->cls, infzero, s);
 +    }
-     pstate_write(env, PSTATE_DAIF | new_mode);
+-    if (s->default_nan_mode || which == 3) {
-     env->aarch64 = 1;
++    if (which == 3) {
          parts_default_nan(a, s);
          return a;
      }
 diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 index XXXXXXX..XXXXXXX 100644
 --- a/fpu/softfloat-specialize.c.inc
 +++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaN(FloatClass a_cls, FloatClass b_cls,
  static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
                           bool infzero, float_status *status)
  {
 +    /*
 +     * We guarantee not to require the target to tell us how to
 +     * pick a NaN if we're always returning the default NaN.
 +     * But if we're not in default-NaN mode then the target must
 +     * specify.
 +     */
 +    assert(!status->default_nan_mode);
  #if defined(TARGET_ARM)
      /* For ARM, the (inf,zero,qnan) case sets InvalidOp and returns
       * the default NaN
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
      } else {
          return 1;
      }
 -#elif defined(TARGET_RISCV)
 -    return 3; /* default NaN */
  #elif defined(TARGET_S390X)
      if (infzero) {
          return 3;
 --
-.20.1
+.34.1

-[PULL 13/57] target/arm: Add isar tests for mte
+[PULL 08/72] softfloat: Allow runtime choice of inf * 0 + NaN result
-From: Richard Henderson <richard.henderson@linaro.org>
+IEEE 758 does not define a fixed rule for what NaN to return in
+the case of a fused multiply-add of inf * 0 + NaN. Different
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+architectures thus do different things:
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+ * some return the default NaN
-Message-id: 20200626033144.790098-2-richard.henderson@linaro.org
+ * some return the input NaN
  * Arm returns the default NaN if the input NaN is quiet,
    and the input NaN if it is signalling
 We want to make this logic be runtime selected rather than
 hardcoded into the binary, because:
  * this will let us have multiple targets in one QEMU binary
  * the Arm FEAT_AFP architectural feature includes letting
    the guest select a NaN propagation rule at runtime
 In this commit we add an enum for the propagation rule, the field in
 float_status, and the corresponding getters and setters.  We change
 pickNaNMulAdd to honour this, but because all targets still leave
 this field at its default 0 value, the fallback logic will pick the
 rule type with the old ifdef ladder.
 Note that four architectures both use the muladd softfloat functions
 and did not have a branch of the ifdef ladder to specify their
 behaviour (and so were ending up with the "default" case, probably
 wrongly): i386, HPPA, SH4 and Tricore.  SH4 and Tricore both set
 default_nan_mode, and so will never get into pickNaNMulAdd().  For
 HPPA and i386 we retain the same behaviour as the old default-case,
 which is to not ever return the default NaN.  This might not be
 correct but it is not a behaviour change.
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-4-peter.maydell@linaro.org
 ---
- target/arm/cpu.h | 10 ++++++++++
+ include/fpu/softfloat-helpers.h | 11 ++++
-file changed, 10 insertions(+)
+ include/fpu/softfloat-types.h   | 23 +++++++++
+ fpu/softfloat-specialize.c.inc  | 91 ++++++++++++++++++++++-----------
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
+files changed, 95 insertions(+), 30 deletions(-)
 diff --git a/include/fpu/softfloat-helpers.h b/include/fpu/softfloat-helpers.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/include/fpu/softfloat-helpers.h
-+++ b/target/arm/cpu.h
++++ b/include/fpu/softfloat-helpers.h
-@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_aa64_bti(const ARMISARegisters *id)
+@@ -XXX,XX +XXX,XX @@ static inline void set_float_2nan_prop_rule(Float2NaNPropRule rule,
-     return FIELD_EX64(id->id_aa64pfr1, ID_AA64PFR1, BT) != 0;
+     status->float_2nan_prop_rule = rule;
  }
-+static inline bool isar_feature_aa64_mte_insn_reg(const ARMISARegisters *id)
++static inline void set_float_infzeronan_rule(FloatInfZeroNaNRule rule,
 +                                             float_status *status)
 +{
-+    return FIELD_EX64(id->id_aa64pfr1, ID_AA64PFR1, MTE) != 0;
++    status->float_infzeronan_rule = rule;
 +}
 +
-+static inline bool isar_feature_aa64_mte(const ARMISARegisters *id)
+ static inline void set_flush_to_zero(bool val, float_status *status)
  {
      status->flush_to_zero = val;
@@ -XXX,XX +XXX,XX @@ static inline Float2NaNPropRule get_float_2nan_prop_rule(float_status *status)
      return status->float_2nan_prop_rule;
  }
 +static inline FloatInfZeroNaNRule get_float_infzeronan_rule(float_status *status)
 +{
-+    return FIELD_EX64(id->id_aa64pfr1, ID_AA64PFR1, MTE) >= 2;
++    return status->float_infzeronan_rule;
 +}
 +
- static inline bool isar_feature_aa64_pmu_8_1(const ARMISARegisters *id)
+ static inline bool get_flush_to_zero(float_status *status)
  {
-     return FIELD_EX64(id->id_aa64dfr0, ID_AA64DFR0, PMUVER) >= 4 &&
+     return status->flush_to_zero;
 diff --git a/include/fpu/softfloat-types.h b/include/fpu/softfloat-types.h
 index XXXXXXX..XXXXXXX 100644
 --- a/include/fpu/softfloat-types.h
 +++ b/include/fpu/softfloat-types.h
@@ -XXX,XX +XXX,XX @@ typedef enum __attribute__((__packed__)) {
      float_2nan_prop_x87,
  } Float2NaNPropRule;
 +/*
 + * Rule for result of fused multiply-add 0 * Inf + NaN.
 + * This must be a NaN, but implementations differ on whether this
 + * is the input NaN or the default NaN.
 + *
 + * You don't need to set this if default_nan_mode is enabled.
 + * When not in default-NaN mode, it is an error for the target
 + * not to set the rule in float_status if it uses muladd, and we
 + * will assert if we need to handle an input NaN and no rule was
 + * selected.
 + */
 +typedef enum __attribute__((__packed__)) {
 +    /* No propagation rule specified */
 +    float_infzeronan_none = 0,
 +    /* Result is never the default NaN (so always the input NaN) */
 +    float_infzeronan_dnan_never,
 +    /* Result is always the default NaN */
 +    float_infzeronan_dnan_always,
 +    /* Result is the default NaN if the input NaN is quiet */
 +    float_infzeronan_dnan_if_qnan,
 +} FloatInfZeroNaNRule;
 +
  /*
   * Floating Point Status. Individual architectures may maintain
   * several versions of float_status for different functions. The
@@ -XXX,XX +XXX,XX @@ typedef struct float_status {
      FloatRoundMode float_rounding_mode;
      FloatX80RoundPrec floatx80_rounding_precision;
      Float2NaNPropRule float_2nan_prop_rule;
 +    FloatInfZeroNaNRule float_infzeronan_rule;
      bool tininess_before_rounding;
      /* should denormalised results go to zero and set the inexact flag? */
      bool flush_to_zero;
 diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 index XXXXXXX..XXXXXXX 100644
 --- a/fpu/softfloat-specialize.c.inc
 +++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaN(FloatClass a_cls, FloatClass b_cls,
  static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
                           bool infzero, float_status *status)
  {
 +    FloatInfZeroNaNRule rule = status->float_infzeronan_rule;
 +
      /*
       * We guarantee not to require the target to tell us how to
       * pick a NaN if we're always returning the default NaN.
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
       * specify.
       */
      assert(!status->default_nan_mode);
 +
 +    if (rule == float_infzeronan_none) {
 +        /*
 +         * Temporarily fall back to ifdef ladder
 +         */
  #if defined(TARGET_ARM)
 -    /* For ARM, the (inf,zero,qnan) case sets InvalidOp and returns
 -     * the default NaN
 -     */
 -    if (infzero && is_qnan(c_cls)) {
 -        return 3;
 +        /*
 +         * For ARM, the (inf,zero,qnan) case returns the default NaN,
 +         * but (inf,zero,snan) returns the input NaN.
 +         */
 +        rule = float_infzeronan_dnan_if_qnan;
 +#elif defined(TARGET_MIPS)
 +        if (snan_bit_is_one(status)) {
 +            /*
 +             * For MIPS systems that conform to IEEE754-1985, the (inf,zero,nan)
 +             * case sets InvalidOp and returns the default NaN
 +             */
 +            rule = float_infzeronan_dnan_always;
 +        } else {
 +            /*
 +             * For MIPS systems that conform to IEEE754-2008, the (inf,zero,nan)
 +             * case sets InvalidOp and returns the input value 'c'
 +             */
 +            rule = float_infzeronan_dnan_never;
 +        }
 +#elif defined(TARGET_PPC) || defined(TARGET_SPARC) || \
 +    defined(TARGET_XTENSA) || defined(TARGET_HPPA) || \
 +    defined(TARGET_I386) || defined(TARGET_LOONGARCH)
 +        /*
 +         * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
 +         * case sets InvalidOp and returns the input value 'c'
 +         */
 +        /*
 +         * For PPC, the (inf,zero,qnan) case sets InvalidOp, but we prefer
 +         * to return an input NaN if we have one (ie c) rather than generating
 +         * a default NaN
 +         */
 +        rule = float_infzeronan_dnan_never;
 +#elif defined(TARGET_S390X)
 +        rule = float_infzeronan_dnan_always;
 +#endif
      }
 +    if (infzero) {
 +        /*
 +         * Inf * 0 + NaN -- some implementations return the default NaN here,
 +         * and some return the input NaN.
 +         */
 +        switch (rule) {
 +        case float_infzeronan_dnan_never:
 +            return 2;
 +        case float_infzeronan_dnan_always:
 +            return 3;
 +        case float_infzeronan_dnan_if_qnan:
 +            return is_qnan(c_cls) ? 3 : 2;
 +        default:
 +            g_assert_not_reached();
 +        }
 +    }
 +
 +#if defined(TARGET_ARM)
 +
      /* This looks different from the ARM ARM pseudocode, because the ARM ARM
       * puts the operands to a fused mac operation (a*b)+c in the order c,a,b.
       */
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
      }
  #elif defined(TARGET_MIPS)
      if (snan_bit_is_one(status)) {
 -        /*
 -         * For MIPS systems that conform to IEEE754-1985, the (inf,zero,nan)
 -         * case sets InvalidOp and returns the default NaN
 -         */
 -        if (infzero) {
 -            return 3;
 -        }
          /* Prefer sNaN over qNaN, in the a, b, c order. */
          if (is_snan(a_cls)) {
              return 0;
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
              return 2;
          }
      } else {
 -        /*
 -         * For MIPS systems that conform to IEEE754-2008, the (inf,zero,nan)
 -         * case sets InvalidOp and returns the input value 'c'
 -         */
          /* Prefer sNaN over qNaN, in the c, a, b order. */
          if (is_snan(c_cls)) {
              return 2;
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
          }
      }
  #elif defined(TARGET_LOONGARCH64)
 -    /*
 -     * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
 -     * case sets InvalidOp and returns the input value 'c'
 -     */
 -
      /* Prefer sNaN over qNaN, in the c, a, b order. */
      if (is_snan(c_cls)) {
          return 2;
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
          return 1;
      }
  #elif defined(TARGET_PPC)
 -    /* For PPC, the (inf,zero,qnan) case sets InvalidOp, but we prefer
 -     * to return an input NaN if we have one (ie c) rather than generating
 -     * a default NaN
 -     */
 -
      /* If fRA is a NaN return it; otherwise if fRB is a NaN return it;
       * otherwise return fRC. Note that muladd on PPC is (fRA * fRC) + frB
       */
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
          return 1;
      }
  #elif defined(TARGET_S390X)
 -    if (infzero) {
 -        return 3;
 -    }
 -
      if (is_snan(a_cls)) {
          return 0;
      } else if (is_snan(b_cls)) {
 --
-.20.1
+.34.1

-[PULL 50/57] target/arm: Complete TBI clearing for user-only for SVE
+[PULL 09/72] tests/fp: Explicitly set inf-zero-nan rule
-From: Richard Henderson <richard.henderson@linaro.org>
+Explicitly set a rule in the softfloat tests for the inf-zero-nan
 muladd special case.  In meson.build we put -DTARGET_ARM in fpcflags,
 and so we should select here the Arm rule of
 float_infzeronan_dnan_if_qnan.
-There are a number of paths by which the TBI is still intact
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-for user-only in the SVE helpers.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Message-id: 20241202131347.498124-5-peter.maydell@linaro.org
 ---
  tests/fp/fp-bench.c | 5 +++++
  tests/fp/fp-test.c  | 5 +++++
 files changed, 10 insertions(+)
-Because we currently always set TBI for user-only, we do not
+diff --git a/tests/fp/fp-bench.c b/tests/fp/fp-bench.c
 need to pass down the actual TBI setting from above, and we
 can remove the top byte in the inner-most primitives, so that
 none are forgotten.  Moreover, this keeps the "dirty" pointer
 around at the higher levels, where we need it for any MTE checking.
 Since the normal case, especially for user-only, goes through
 RAM, this clearing merely adds two insns per page lookup, which
 will be completely in the noise.
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20200626033144.790098-39-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/cpu.c           |  3 +++
  target/arm/sve_helper.c    | 19 +++++++++++++++++--
  target/arm/translate-a64.c |  5 +++++
 files changed, 25 insertions(+), 2 deletions(-)
 diff --git a/target/arm/cpu.c b/target/arm/cpu.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.c
+--- a/tests/fp/fp-bench.c
-+++ b/target/arm/cpu.c
++++ b/tests/fp/fp-bench.c
-@@ -XXX,XX +XXX,XX @@ static void arm_cpu_reset(DeviceState *dev)
+@@ -XXX,XX +XXX,XX @@ static void run_bench(void)
-          * Enable TBI0 and TBI1.  While the real kernel only enables TBI0,
+ {
-          * turning on both here will produce smaller code and otherwise
+     bench_func_t f;
-          * make no difference to the user-level emulation.
-+         *
++    /*
-+         * In sve_probe_page, we assume that this is set.
++     * These implementation-defined choices for various things IEEE
-+         * Do not modify this without other changes.
++     * doesn't specify match those used by the Arm architecture.
-          */
++     */
-         env->cp15.tcr_el[1].raw_tcr = (3ULL << 37);
+     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &soft_status);
- #else
++    set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, &soft_status);
-diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
      f = bench_funcs[operation][precision];
      g_assert(f);
 diff --git a/tests/fp/fp-test.c b/tests/fp/fp-test.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve_helper.c
+--- a/tests/fp/fp-test.c
-+++ b/target/arm/sve_helper.c
++++ b/tests/fp/fp-test.c
-@@ -XXX,XX +XXX,XX @@ static void sve_##NAME##_host(void *vd, intptr_t reg_off, void *host)  \
+@@ -XXX,XX +XXX,XX @@ void run_test(void)
- static void sve_##NAME##_tlb(CPUARMState *env, void *vd, intptr_t reg_off,  \
+ {
-                              target_ulong addr, uintptr_t ra)               \
+     unsigned int i;
- {                                                                           \
 -    *(TYPEE *)(vd + H(reg_off)) = (TYPEM)TLB(env, addr, ra);                \
 +    *(TYPEE *)(vd + H(reg_off)) =                                           \
 +        (TYPEM)TLB(env, useronly_clean_ptr(addr), ra);                      \
  }
  #define DO_ST_TLB(NAME, H, TYPEE, TYPEM, TLB) \
  static void sve_##NAME##_tlb(CPUARMState *env, void *vd, intptr_t reg_off,  \
                               target_ulong addr, uintptr_t ra)               \
  {                                                                           \
 -    TLB(env, addr, (TYPEM)*(TYPEE *)(vd + H(reg_off)), ra);                 \
 +    TLB(env, useronly_clean_ptr(addr),                                      \
 +        (TYPEM)*(TYPEE *)(vd + H(reg_off)), ra);                            \
  }
  #define DO_LD_PRIM_1(NAME, H, TE, TM)                   \
@@ -XXX,XX +XXX,XX @@ static bool sve_probe_page(SVEHostPage *info, bool nofault,
      int flags;
      addr += mem_off;
 +
 +    /*
-+     * User-only currently always issues with TBI.  See the comment
++     * These implementation-defined choices for various things IEEE
-+     * above useronly_clean_ptr.  Usually we clean this top byte away
++     * doesn't specify match those used by the Arm architecture.
 +     * during translation, but we can't do that for e.g. vector + imm
 +     * addressing modes.
 +     *
 +     * We currently always enable TBI for user-only, and do not provide
 +     * a way to turn it off.  So clean the pointer unconditionally here,
 +     * rather than look it up here, or pass it down from above.
 +     */
-+    addr = useronly_clean_ptr(addr);
+     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &qsf);
-+
++    set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, &qsf);
-     flags = probe_access_flags(env, addr, access_type, mmu_idx, nofault,
-                                &info->host, retaddr);
+     genCases_setLevel(test_level);
-     info->flags = flags;
+     verCases_maxErrorCount = n_max_errors;
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_init_disas_context(DisasContextBase *dcbase,
      dc->features = env->features;
      dc->dcz_blocksize = arm_cpu->dcz_blocksize;
 +#ifdef CONFIG_USER_ONLY
 +    /* In sve_probe_page, we assume TBI is enabled. */
 +    tcg_debug_assert(dc->tbid & 1);
 +#endif
 +
      /* Single step state. The code-generation logic here is:
       *  SS_ACTIVE == 0:
       *   generate code with no special handling for single-stepping (except
 --
-.20.1
+.34.1

-[PULL 29/57] target/arm: Restrict the values of DCZID.BS under TCG
+[PULL 10/72] target/arm: Set FloatInfZeroNaNRule explicitly
-From: Richard Henderson <richard.henderson@linaro.org>
+Set the FloatInfZeroNaNRule explicitly for the Arm target,
 so we can remove the ifdef from pickNaNMulAdd().
-We can simplify our DC_ZVA if we recognize that the largest BS
-that we actually use in system mode is 64.  Let us just assert
-that it fits within TARGET_PAGE_SIZE.
-For DC_GVA and STZGM, we want to be able to write whole bytes
-of tag memory, so assert that BS is >= 2 * TAG_GRANULE, or 32.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20200626033144.790098-18-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-6-peter.maydell@linaro.org
 ---
- target/arm/cpu.c | 24 ++++++++++++++++++++++++
+ target/arm/cpu.c               | 3 +++
-file changed, 24 insertions(+)
+ fpu/softfloat-specialize.c.inc | 8 +-------
 files changed, 4 insertions(+), 7 deletions(-)
 diff --git a/target/arm/cpu.c b/target/arm/cpu.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu.c
 +++ b/target/arm/cpu.c
-@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
+@@ -XXX,XX +XXX,XX @@ void arm_register_el_change_hook(ARMCPU *cpu, ARMELChangeHookFn *hook,
-     }
+  *  * tininess-before-rounding
- #endif
+  *  * 2-input NaN propagation prefers SNaN over QNaN, and then
+  *    operand A over operand B (see FPProcessNaNs() pseudocode)
-+    if (tcg_enabled()) {
++ *  * 0 * Inf + NaN returns the default NaN if the input NaN is quiet,
-+        int dcz_blocklen = 4 << cpu->dcz_blocksize;
++ *    and the input NaN if it is signalling
-+
+  */
-+        /*
+ static void arm_set_default_fp_behaviours(float_status *s)
-+         * We only support DCZ blocklen that fits on one page.
+ {
-+         *
+     set_float_detect_tininess(float_tininess_before_rounding, s);
-+         * Architectually this is always true.  However TARGET_PAGE_SIZE
+     set_float_2nan_prop_rule(float_2nan_prop_s_ab, s);
-+         * is variable and, for compatibility with -machine virt-2.7,
++    set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, s);
-+         * is only 1KiB, as an artifact of legacy ARMv5 subpage support.
+ }
-+         * But even then, while the largest architectural DCZ blocklen
-+         * is 2KiB, no cpu actually uses such a large blocklen.
+ static void cp_reg_reset(gpointer key, gpointer value, gpointer opaque)
-+         */
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
-+        assert(dcz_blocklen <= TARGET_PAGE_SIZE);
+index XXXXXXX..XXXXXXX 100644
-+
+--- a/fpu/softfloat-specialize.c.inc
-+        /*
++++ b/fpu/softfloat-specialize.c.inc
-+         * We only support DCZ blocksize >= 2*TAG_GRANULE, which is to say
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
-+         * both nibbles of each byte storing tag data may be written at once.
+         /*
-+         * Since TAG_GRANULE is 16, this means that blocklen must be >= 32.
+          * Temporarily fall back to ifdef ladder
-+         */
+          */
-+        if (cpu_isar_feature(aa64_mte, cpu)) {
+-#if defined(TARGET_ARM)
-+            assert(dcz_blocklen >= 2 * TAG_GRANULE);
+-        /*
-+        }
+-         * For ARM, the (inf,zero,qnan) case returns the default NaN,
-+    }
+-         * but (inf,zero,snan) returns the input NaN.
-+
+-         */
-     qemu_init_vcpu(cs);
+-        rule = float_infzeronan_dnan_if_qnan;
-     cpu_reset(cs);
+-#elif defined(TARGET_MIPS)
++#if defined(TARGET_MIPS)
          if (snan_bit_is_one(status)) {
              /*
               * For MIPS systems that conform to IEEE754-1985, the (inf,zero,nan)
 --
-.20.1
+.34.1

-[PULL 28/57] target/arm: Implement the STGP instruction
+[PULL 11/72] target/s390: Set FloatInfZeroNaNRule explicitly
-From: Richard Henderson <richard.henderson@linaro.org>
+Set the FloatInfZeroNaNRule explicitly for s390, so we
 can remove the ifdef from pickNaNMulAdd().
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20200626033144.790098-17-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-7-peter.maydell@linaro.org
 ---
- target/arm/translate-a64.c | 29 ++++++++++++++++++++++++++---
+ target/s390x/cpu.c             | 2 ++
-file changed, 26 insertions(+), 3 deletions(-)
+ fpu/softfloat-specialize.c.inc | 2 --
 files changed, 2 insertions(+), 2 deletions(-)
-diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
+diff --git a/target/s390x/cpu.c b/target/s390x/cpu.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-a64.c
+--- a/target/s390x/cpu.c
-+++ b/target/arm/translate-a64.c
++++ b/target/s390x/cpu.c
-@@ -XXX,XX +XXX,XX @@ static void disas_ld_lit(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static void s390_cpu_reset_hold(Object *obj, ResetType type)
-  * +-----+-------+---+---+-------+---+-------+-------+------+------+
+         set_float_detect_tininess(float_tininess_before_rounding,
-  *
+                                   &env->fpu_status);
-  * opc: LDP/STP/LDNP/STNP        00 -> 32 bit, 10 -> 64 bit
+         set_float_2nan_prop_rule(float_2nan_prop_s_ab, &env->fpu_status);
-- *      LDPSW                    01
++        set_float_infzeronan_rule(float_infzeronan_dnan_always,
-+ *      LDPSW/STGP               01
++                                  &env->fpu_status);
-  *      LDP/STP/LDNP/STNP (SIMD) 00 -> 32 bit, 01 -> 64 bit, 10 -> 128 bit
+        /* fall through */
-  *   V: 0 -> GPR, 1 -> Vector
+     case RESET_TYPE_S390_CPU_NORMAL:
-  * idx: 00 -> signed offset with non-temporal hint, 01 -> post-index,
+         env->psw.mask &= ~PSW_MASK_RI;
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_pair(DisasContext *s, uint32_t insn)
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
-     bool is_signed = false;
+index XXXXXXX..XXXXXXX 100644
-     bool postindex = false;
+--- a/fpu/softfloat-specialize.c.inc
-     bool wback = false;
++++ b/fpu/softfloat-specialize.c.inc
-+    bool set_tag = false;
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
+          * a default NaN
-     TCGv_i64 clean_addr, dirty_addr;
+          */
+         rule = float_infzeronan_dnan_never;
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_pair(DisasContext *s, uint32_t insn)
+-#elif defined(TARGET_S390X)
+-        rule = float_infzeronan_dnan_always;
-     if (is_vector) {
+ #endif
          size = 2 + opc;
 +    } else if (opc == 1 && !is_load) {
 +        /* STGP */
 +        if (!dc_isar_feature(aa64_mte_insn_reg, s) || index == 0) {
 +            unallocated_encoding(s);
 +            return;
 +        }
 +        size = 3;
 +        set_tag = true;
      } else {
          size = 2 + extract32(opc, 1, 1);
          is_signed = extract32(opc, 0, 1);
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_pair(DisasContext *s, uint32_t insn)
          return;
      }
--    offset <<= size;
-+    offset <<= (set_tag ? LOG2_TAG_GRANULE : size);
-     if (rn == 31) {
-         gen_check_sp_alignment(s);
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_pair(DisasContext *s, uint32_t insn)
-     if (!postindex) {
-         tcg_gen_addi_i64(dirty_addr, dirty_addr, offset);
-     }
--    clean_addr = clean_data_tbi(s, dirty_addr);
-+    if (set_tag) {
-+        if (!s->ata) {
-+            /*
-+             * TODO: We could rely on the stores below, at least for
-+             * system mode, if we arrange to add MO_ALIGN_16.
-+             */
-+            gen_helper_stg_stub(cpu_env, dirty_addr);
-+        } else if (tb_cflags(s->base.tb) & CF_PARALLEL) {
-+            gen_helper_stg_parallel(cpu_env, dirty_addr, dirty_addr);
-+        } else {
-+            gen_helper_stg(cpu_env, dirty_addr, dirty_addr);
-+        }
-+    }
-+
-+    clean_addr = clean_data_tbi(s, dirty_addr);
-     if (is_vector) {
-         if (is_load) {
-             do_fp_ld(s, rt, clean_addr, size);
 --
-.20.1
+.34.1

-[PULL 46/57] target/arm: Add mte helpers for sve scalar + int stores
+[PULL 12/72] target/ppc: Set FloatInfZeroNaNRule explicitly
-From: Richard Henderson <richard.henderson@linaro.org>
+Set the FloatInfZeroNaNRule explicitly for the PPC target,
 so we can remove the ifdef from pickNaNMulAdd().
-Because the elements are sequential, we can eliminate many tests all
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-at once when the tag hits TCMA, or if the page(s) are not Tagged.
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20241202131347.498124-8-peter.maydell@linaro.org
 ---
  target/ppc/cpu_init.c          | 7 +++++++
  fpu/softfloat-specialize.c.inc | 7 +------
 files changed, 8 insertions(+), 6 deletions(-)
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+diff --git a/target/ppc/cpu_init.c b/target/ppc/cpu_init.c
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20200626033144.790098-35-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/helper-sve.h    |  47 +++++++++++
  target/arm/sve_helper.c    |  95 ++++++++++++++++------
  target/arm/translate-sve.c | 162 ++++++++++++++++++++++++-------------
 files changed, 226 insertions(+), 78 deletions(-)
 diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
+--- a/target/ppc/cpu_init.c
-+++ b/target/arm/helper-sve.h
++++ b/target/ppc/cpu_init.c
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_4(sve_st1hd_be_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+@@ -XXX,XX +XXX,XX @@ static void ppc_cpu_reset_hold(Object *obj, ResetType type)
- DEF_HELPER_FLAGS_4(sve_st1sd_le_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+      */
- DEF_HELPER_FLAGS_4(sve_st1sd_be_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+     set_float_2nan_prop_rule(float_2nan_prop_ab, &env->fp_status);
+     set_float_2nan_prop_rule(float_2nan_prop_ab, &env->vec_status);
-+DEF_HELPER_FLAGS_4(sve_st1bb_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
++    /*
-+DEF_HELPER_FLAGS_4(sve_st2bb_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
++     * For PPC, the (inf,zero,qnan) case sets InvalidOp, but we prefer
-+DEF_HELPER_FLAGS_4(sve_st3bb_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
++     * to return an input NaN if we have one (ie c) rather than generating
-+DEF_HELPER_FLAGS_4(sve_st4bb_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
++     * a default NaN
-+
++     */
-+DEF_HELPER_FLAGS_4(sve_st1hh_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
++    set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
-+DEF_HELPER_FLAGS_4(sve_st2hh_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
++    set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->vec_status);
-+DEF_HELPER_FLAGS_4(sve_st3hh_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_st4hh_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+     for (i = 0; i < ARRAY_SIZE(env->spr_cb); i++) {
-+
+         ppc_spr_t *spr = &env->spr_cb[i];
-+DEF_HELPER_FLAGS_4(sve_st1hh_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 +DEF_HELPER_FLAGS_4(sve_st2hh_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st3hh_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st4hh_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_st1ss_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st2ss_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st3ss_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st4ss_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_st1ss_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st2ss_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st3ss_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st4ss_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_st1dd_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st2dd_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st3dd_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st4dd_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_st1dd_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st2dd_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st3dd_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st4dd_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_st1bh_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st1bs_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st1bd_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_st1hs_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st1hd_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st1hs_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st1hd_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_st1sd_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_st1sd_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
  DEF_HELPER_FLAGS_6(sve_ldbsu_zsu, TCG_CALL_NO_WG,
                     void, env, ptr, ptr, ptr, tl, i32)
  DEF_HELPER_FLAGS_6(sve_ldhsu_le_zsu, TCG_CALL_NO_WG,
 diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve_helper.c
+--- a/fpu/softfloat-specialize.c.inc
-+++ b/target/arm/sve_helper.c
++++ b/fpu/softfloat-specialize.c.inc
-@@ -XXX,XX +XXX,XX @@ DO_LDFF1_LDNF1_2(dd,  MO_64, MO_64)
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
-  */
+              */
+             rule = float_infzeronan_dnan_never;
- static inline QEMU_ALWAYS_INLINE
+         }
--void sve_stN_r(CPUARMState *env, uint64_t *vg, target_ulong addr, uint32_t desc,
+-#elif defined(TARGET_PPC) || defined(TARGET_SPARC) || \
--               const uintptr_t retaddr, const int esz,
++#elif defined(TARGET_SPARC) || \
--               const int msz, const int N,
+     defined(TARGET_XTENSA) || defined(TARGET_HPPA) || \
-+void sve_stN_r(CPUARMState *env, uint64_t *vg, target_ulong addr,
+     defined(TARGET_I386) || defined(TARGET_LOONGARCH)
-+               uint32_t desc, const uintptr_t retaddr,
+         /*
-+               const int esz, const int msz, const int N, uint32_t mtedesc,
+          * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
-                sve_ldst1_host_fn *host_fn,
+          * case sets InvalidOp and returns the input value 'c'
--               sve_ldst1_tlb_fn *tlb_fn)
+          */
-+               sve_ldst1_tlb_fn *tlb_fn,
+-        /*
-+               sve_cont_ldst_mte_check_fn *mte_check_fn)
+-         * For PPC, the (inf,zero,qnan) case sets InvalidOp, but we prefer
- {
+-         * to return an input NaN if we have one (ie c) rather than generating
-     const unsigned rd = simd_data(desc);
+-         * a default NaN
-     const intptr_t reg_max = simd_oprsz(desc);
+-         */
-@@ -XXX,XX +XXX,XX @@ void sve_stN_r(CPUARMState *env, uint64_t *vg, target_ulong addr, uint32_t desc,
+         rule = float_infzeronan_dnan_never;
-     sve_cont_ldst_watchpoints(&info, env, vg, addr, 1 << esz, N << msz,
+ #endif
                                BP_MEM_WRITE, retaddr);
 -    /* TODO: MTE check. */
 +    /*
 +     * Handle mte checks for all active elements.
 +     * Since TBI must be set for MTE, !mtedesc => !mte_active.
 +     */
 +    if (mte_check_fn && mtedesc) {
 +        mte_check_fn(&info, env, vg, addr, 1 << esz, N << msz,
 +                     mtedesc, retaddr);
 +    }
      flags = info.page[0].flags | info.page[1].flags;
      if (unlikely(flags != 0)) {
@@ -XXX,XX +XXX,XX @@ void sve_stN_r(CPUARMState *env, uint64_t *vg, target_ulong addr, uint32_t desc,
      }
- }
--#define DO_STN_1(N, NAME, ESZ) \
--void HELPER(sve_st##N##NAME##_r)(CPUARMState *env, void *vg,        \
--                                 target_ulong addr, uint32_t desc)  \
--{                                                                   \
--    sve_stN_r(env, vg, addr, desc, GETPC(), ESZ, MO_8, N,           \
--              sve_st1##NAME##_host, sve_st1##NAME##_tlb);           \
-+static inline QEMU_ALWAYS_INLINE
-+void sve_stN_r_mte(CPUARMState *env, uint64_t *vg, target_ulong addr,
-+                   uint32_t desc, const uintptr_t ra,
-+                   const int esz, const int msz, const int N,
-+                   sve_ldst1_host_fn *host_fn,
-+                   sve_ldst1_tlb_fn *tlb_fn)
-+{
-+    uint32_t mtedesc = desc >> (SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
-+    int bit55 = extract64(addr, 55, 1);
-+
-+    /* Remove mtedesc from the normal sve descriptor. */
-+    desc = extract32(desc, 0, SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
-+
-+    /* Perform gross MTE suppression early. */
-+    if (!tbi_check(desc, bit55) ||
-+        tcma_check(desc, bit55, allocation_tag_from_addr(addr))) {
-+        mtedesc = 0;
-+    }
-+
-+    sve_stN_r(env, vg, addr, desc, ra, esz, msz, N, mtedesc, host_fn, tlb_fn,
-+              N == 1 ? sve_cont_ldst_mte_check1 : sve_cont_ldst_mte_checkN);
- }
--#define DO_STN_2(N, NAME, ESZ, MSZ) \
--void HELPER(sve_st##N##NAME##_le_r)(CPUARMState *env, void *vg,       \
--                                    target_ulong addr, uint32_t desc) \
--{                                                                     \
--    sve_stN_r(env, vg, addr, desc, GETPC(), ESZ, MSZ, N,              \
--              sve_st1##NAME##_le_host, sve_st1##NAME##_le_tlb);       \
--}                                                                     \
--void HELPER(sve_st##N##NAME##_be_r)(CPUARMState *env, void *vg,       \
--                                    target_ulong addr, uint32_t desc) \
--{                                                                     \
--    sve_stN_r(env, vg, addr, desc, GETPC(), ESZ, MSZ, N,              \
--              sve_st1##NAME##_be_host, sve_st1##NAME##_be_tlb);       \
-+#define DO_STN_1(N, NAME, ESZ)                                          \
-+void HELPER(sve_st##N##NAME##_r)(CPUARMState *env, void *vg,            \
-+                                 target_ulong addr, uint32_t desc)      \
-+{                                                                       \
-+    sve_stN_r(env, vg, addr, desc, GETPC(), ESZ, MO_8, N, 0,            \
-+              sve_st1##NAME##_host, sve_st1##NAME##_tlb, NULL);         \
-+}                                                                       \
-+void HELPER(sve_st##N##NAME##_r_mte)(CPUARMState *env, void *vg,        \
-+                                     target_ulong addr, uint32_t desc)  \
-+{                                                                       \
-+    sve_stN_r_mte(env, vg, addr, desc, GETPC(), ESZ, MO_8, N,           \
-+                  sve_st1##NAME##_host, sve_st1##NAME##_tlb);           \
-+}
-+
-+#define DO_STN_2(N, NAME, ESZ, MSZ)                                     \
-+void HELPER(sve_st##N##NAME##_le_r)(CPUARMState *env, void *vg,         \
-+                                    target_ulong addr, uint32_t desc)   \
-+{                                                                       \
-+    sve_stN_r(env, vg, addr, desc, GETPC(), ESZ, MSZ, N, 0,             \
-+              sve_st1##NAME##_le_host, sve_st1##NAME##_le_tlb, NULL);   \
-+}                                                                       \
-+void HELPER(sve_st##N##NAME##_be_r)(CPUARMState *env, void *vg,         \
-+                                    target_ulong addr, uint32_t desc)   \
-+{                                                                       \
-+    sve_stN_r(env, vg, addr, desc, GETPC(), ESZ, MSZ, N, 0,             \
-+              sve_st1##NAME##_be_host, sve_st1##NAME##_be_tlb, NULL);   \
-+}                                                                       \
-+void HELPER(sve_st##N##NAME##_le_r_mte)(CPUARMState *env, void *vg,     \
-+                                        target_ulong addr, uint32_t desc) \
-+{                                                                       \
-+    sve_stN_r_mte(env, vg, addr, desc, GETPC(), ESZ, MSZ, N,            \
-+                  sve_st1##NAME##_le_host, sve_st1##NAME##_le_tlb);     \
-+}                                                                       \
-+void HELPER(sve_st##N##NAME##_be_r_mte)(CPUARMState *env, void *vg,     \
-+                                        target_ulong addr, uint32_t desc) \
-+{                                                                       \
-+    sve_stN_r_mte(env, vg, addr, desc, GETPC(), ESZ, MSZ, N,            \
-+                  sve_st1##NAME##_be_host, sve_st1##NAME##_be_tlb);     \
- }
- DO_STN_1(1, bb, MO_8)
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
-+++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static bool trans_LD1R_zpri(DisasContext *s, arg_rpri_load *a)
- static void do_st_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
-                       int msz, int esz, int nreg)
- {
--    static gen_helper_gvec_mem * const fn_single[2][4][4] = {
--        { { gen_helper_sve_st1bb_r,
--            gen_helper_sve_st1bh_r,
--            gen_helper_sve_st1bs_r,
--            gen_helper_sve_st1bd_r },
--          { NULL,
--            gen_helper_sve_st1hh_le_r,
--            gen_helper_sve_st1hs_le_r,
--            gen_helper_sve_st1hd_le_r },
--          { NULL, NULL,
--            gen_helper_sve_st1ss_le_r,
--            gen_helper_sve_st1sd_le_r },
--          { NULL, NULL, NULL,
--            gen_helper_sve_st1dd_le_r } },
--        { { gen_helper_sve_st1bb_r,
--            gen_helper_sve_st1bh_r,
--            gen_helper_sve_st1bs_r,
--            gen_helper_sve_st1bd_r },
--          { NULL,
--            gen_helper_sve_st1hh_be_r,
--            gen_helper_sve_st1hs_be_r,
--            gen_helper_sve_st1hd_be_r },
--          { NULL, NULL,
--            gen_helper_sve_st1ss_be_r,
--            gen_helper_sve_st1sd_be_r },
--          { NULL, NULL, NULL,
--            gen_helper_sve_st1dd_be_r } },
-+    static gen_helper_gvec_mem * const fn_single[2][2][4][4] = {
-+        { { { gen_helper_sve_st1bb_r,
-+              gen_helper_sve_st1bh_r,
-+              gen_helper_sve_st1bs_r,
-+              gen_helper_sve_st1bd_r },
-+            { NULL,
-+              gen_helper_sve_st1hh_le_r,
-+              gen_helper_sve_st1hs_le_r,
-+              gen_helper_sve_st1hd_le_r },
-+            { NULL, NULL,
-+              gen_helper_sve_st1ss_le_r,
-+              gen_helper_sve_st1sd_le_r },
-+            { NULL, NULL, NULL,
-+              gen_helper_sve_st1dd_le_r } },
-+          { { gen_helper_sve_st1bb_r,
-+              gen_helper_sve_st1bh_r,
-+              gen_helper_sve_st1bs_r,
-+              gen_helper_sve_st1bd_r },
-+            { NULL,
-+              gen_helper_sve_st1hh_be_r,
-+              gen_helper_sve_st1hs_be_r,
-+              gen_helper_sve_st1hd_be_r },
-+            { NULL, NULL,
-+              gen_helper_sve_st1ss_be_r,
-+              gen_helper_sve_st1sd_be_r },
-+            { NULL, NULL, NULL,
-+              gen_helper_sve_st1dd_be_r } } },
-+
-+        { { { gen_helper_sve_st1bb_r_mte,
-+              gen_helper_sve_st1bh_r_mte,
-+              gen_helper_sve_st1bs_r_mte,
-+              gen_helper_sve_st1bd_r_mte },
-+            { NULL,
-+              gen_helper_sve_st1hh_le_r_mte,
-+              gen_helper_sve_st1hs_le_r_mte,
-+              gen_helper_sve_st1hd_le_r_mte },
-+            { NULL, NULL,
-+              gen_helper_sve_st1ss_le_r_mte,
-+              gen_helper_sve_st1sd_le_r_mte },
-+            { NULL, NULL, NULL,
-+              gen_helper_sve_st1dd_le_r_mte } },
-+          { { gen_helper_sve_st1bb_r_mte,
-+              gen_helper_sve_st1bh_r_mte,
-+              gen_helper_sve_st1bs_r_mte,
-+              gen_helper_sve_st1bd_r_mte },
-+            { NULL,
-+              gen_helper_sve_st1hh_be_r_mte,
-+              gen_helper_sve_st1hs_be_r_mte,
-+              gen_helper_sve_st1hd_be_r_mte },
-+            { NULL, NULL,
-+              gen_helper_sve_st1ss_be_r_mte,
-+              gen_helper_sve_st1sd_be_r_mte },
-+            { NULL, NULL, NULL,
-+              gen_helper_sve_st1dd_be_r_mte } } },
-     };
--    static gen_helper_gvec_mem * const fn_multiple[2][3][4] = {
--        { { gen_helper_sve_st2bb_r,
--            gen_helper_sve_st2hh_le_r,
--            gen_helper_sve_st2ss_le_r,
--            gen_helper_sve_st2dd_le_r },
--          { gen_helper_sve_st3bb_r,
--            gen_helper_sve_st3hh_le_r,
--            gen_helper_sve_st3ss_le_r,
--            gen_helper_sve_st3dd_le_r },
--          { gen_helper_sve_st4bb_r,
--            gen_helper_sve_st4hh_le_r,
--            gen_helper_sve_st4ss_le_r,
--            gen_helper_sve_st4dd_le_r } },
--        { { gen_helper_sve_st2bb_r,
--            gen_helper_sve_st2hh_be_r,
--            gen_helper_sve_st2ss_be_r,
--            gen_helper_sve_st2dd_be_r },
--          { gen_helper_sve_st3bb_r,
--            gen_helper_sve_st3hh_be_r,
--            gen_helper_sve_st3ss_be_r,
--            gen_helper_sve_st3dd_be_r },
--          { gen_helper_sve_st4bb_r,
--            gen_helper_sve_st4hh_be_r,
--            gen_helper_sve_st4ss_be_r,
--            gen_helper_sve_st4dd_be_r } },
-+    static gen_helper_gvec_mem * const fn_multiple[2][2][3][4] = {
-+        { { { gen_helper_sve_st2bb_r,
-+              gen_helper_sve_st2hh_le_r,
-+              gen_helper_sve_st2ss_le_r,
-+              gen_helper_sve_st2dd_le_r },
-+            { gen_helper_sve_st3bb_r,
-+              gen_helper_sve_st3hh_le_r,
-+              gen_helper_sve_st3ss_le_r,
-+              gen_helper_sve_st3dd_le_r },
-+            { gen_helper_sve_st4bb_r,
-+              gen_helper_sve_st4hh_le_r,
-+              gen_helper_sve_st4ss_le_r,
-+              gen_helper_sve_st4dd_le_r } },
-+          { { gen_helper_sve_st2bb_r,
-+              gen_helper_sve_st2hh_be_r,
-+              gen_helper_sve_st2ss_be_r,
-+              gen_helper_sve_st2dd_be_r },
-+            { gen_helper_sve_st3bb_r,
-+              gen_helper_sve_st3hh_be_r,
-+              gen_helper_sve_st3ss_be_r,
-+              gen_helper_sve_st3dd_be_r },
-+            { gen_helper_sve_st4bb_r,
-+              gen_helper_sve_st4hh_be_r,
-+              gen_helper_sve_st4ss_be_r,
-+              gen_helper_sve_st4dd_be_r } } },
-+        { { { gen_helper_sve_st2bb_r_mte,
-+              gen_helper_sve_st2hh_le_r_mte,
-+              gen_helper_sve_st2ss_le_r_mte,
-+              gen_helper_sve_st2dd_le_r_mte },
-+            { gen_helper_sve_st3bb_r_mte,
-+              gen_helper_sve_st3hh_le_r_mte,
-+              gen_helper_sve_st3ss_le_r_mte,
-+              gen_helper_sve_st3dd_le_r_mte },
-+            { gen_helper_sve_st4bb_r_mte,
-+              gen_helper_sve_st4hh_le_r_mte,
-+              gen_helper_sve_st4ss_le_r_mte,
-+              gen_helper_sve_st4dd_le_r_mte } },
-+          { { gen_helper_sve_st2bb_r_mte,
-+              gen_helper_sve_st2hh_be_r_mte,
-+              gen_helper_sve_st2ss_be_r_mte,
-+              gen_helper_sve_st2dd_be_r_mte },
-+            { gen_helper_sve_st3bb_r_mte,
-+              gen_helper_sve_st3hh_be_r_mte,
-+              gen_helper_sve_st3ss_be_r_mte,
-+              gen_helper_sve_st3dd_be_r_mte },
-+            { gen_helper_sve_st4bb_r_mte,
-+              gen_helper_sve_st4hh_be_r_mte,
-+              gen_helper_sve_st4ss_be_r_mte,
-+              gen_helper_sve_st4dd_be_r_mte } } },
-     };
-     gen_helper_gvec_mem *fn;
-     int be = s->be_data == MO_BE;
-     if (nreg == 0) {
-         /* ST1 */
--        fn = fn_single[be][msz][esz];
-+        fn = fn_single[s->mte_active[0]][be][msz][esz];
-+        nreg = 1;
-     } else {
-         /* ST2, ST3, ST4 -- msz == esz, enforced by encoding */
-         assert(msz == esz);
--        fn = fn_multiple[be][nreg - 1][msz];
-+        fn = fn_multiple[s->mte_active[0]][be][nreg - 1][msz];
-     }
-     assert(fn != NULL);
--    do_mem_zpa(s, zt, pg, addr, msz_dtype(s, msz), 0, true, fn);
-+    do_mem_zpa(s, zt, pg, addr, msz_dtype(s, msz), nreg, true, fn);
- }
- static bool trans_ST_zprr(DisasContext *s, arg_rprr_store *a)
 --
-.20.1
+.34.1

-[PULL 03/57] hw/arm/aspeed: QOM'ify AspeedMachineState
+[PULL 13/72] target/mips: Set FloatInfZeroNaNRule explicitly
-From: Philippe Mathieu-Daudé <f4bug@amsat.org>
+Set the FloatInfZeroNaNRule explicitly for the MIPS target,
 so we can remove the ifdef from pickNaNMulAdd().
-AspeedMachineState seems crippled. We use incorrectly 2
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-different structures to do the same thing. Merge them
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-altogether:
+Message-id: 20241202131347.498124-9-peter.maydell@linaro.org
-- Move AspeedMachine fields to AspeedMachineState
+---
-- AspeedMachineState is now QOM
+ target/mips/fpu_helper.h       |  9 +++++++++
-- Remove unused AspeedMachine structure
+ target/mips/msa.c              |  4 ++++
  fpu/softfloat-specialize.c.inc | 16 +---------------
 files changed, 14 insertions(+), 15 deletions(-)
-Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
+diff --git a/target/mips/fpu_helper.h b/target/mips/fpu_helper.h
 Reviewed-by: Cédric Le Goater <clg@kaod.org>
 Message-id: 20200623072132.2868-4-f4bug@amsat.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  include/hw/arm/aspeed.h |  8 +-------
  hw/arm/aspeed.c         | 11 +++++++----
 files changed, 8 insertions(+), 11 deletions(-)
 diff --git a/include/hw/arm/aspeed.h b/include/hw/arm/aspeed.h
 index XXXXXXX..XXXXXXX 100644
---- a/include/hw/arm/aspeed.h
+--- a/target/mips/fpu_helper.h
-+++ b/include/hw/arm/aspeed.h
++++ b/target/mips/fpu_helper.h
-@@ -XXX,XX +XXX,XX @@ typedef struct AspeedMachineState AspeedMachineState;
+@@ -XXX,XX +XXX,XX @@ static inline void restore_flush_mode(CPUMIPSState *env)
+ static inline void restore_snan_bit_mode(CPUMIPSState *env)
- #define TYPE_ASPEED_MACHINE       MACHINE_TYPE_NAME("aspeed")
+ {
- #define ASPEED_MACHINE(obj) \
+     bool nan2008 = env->active_fpu.fcr31 & (1 << FCR31_NAN2008);
--    OBJECT_CHECK(AspeedMachine, (obj), TYPE_ASPEED_MACHINE)
++    FloatInfZeroNaNRule izn_rule;
--
--typedef struct AspeedMachine {
+     /*
--    MachineState parent_obj;
+      * With nan2008, SNaNs are silenced in the usual way.
--
+@@ -XXX,XX +XXX,XX @@ static inline void restore_snan_bit_mode(CPUMIPSState *env)
--    bool mmio_exec;
+      */
--} AspeedMachine;
+     set_snan_bit_is_one(!nan2008, &env->active_fpu.fp_status);
-+    OBJECT_CHECK(AspeedMachineState, (obj), TYPE_ASPEED_MACHINE)
+     set_default_nan_mode(!nan2008, &env->active_fpu.fp_status);
++    /*
- #define ASPEED_MAC0_ON   (1 << 0)
++     * For MIPS systems that conform to IEEE754-1985, the (inf,zero,nan)
- #define ASPEED_MAC1_ON   (1 << 1)
++     * case sets InvalidOp and returns the default NaN.
-diff --git a/hw/arm/aspeed.c b/hw/arm/aspeed.c
++     * For MIPS systems that conform to IEEE754-2008, the (inf,zero,nan)
 +     * case sets InvalidOp and returns the input value 'c'.
 +     */
 +    izn_rule = nan2008 ? float_infzeronan_dnan_never : float_infzeronan_dnan_always;
 +    set_float_infzeronan_rule(izn_rule, &env->active_fpu.fp_status);
  }
  static inline void restore_fp_status(CPUMIPSState *env)
 diff --git a/target/mips/msa.c b/target/mips/msa.c
 index XXXXXXX..XXXXXXX 100644
---- a/hw/arm/aspeed.c
+--- a/target/mips/msa.c
-+++ b/hw/arm/aspeed.c
++++ b/target/mips/msa.c
-@@ -XXX,XX +XXX,XX @@ static struct arm_boot_info aspeed_board_binfo = {
+@@ -XXX,XX +XXX,XX @@ void msa_reset(CPUMIPSState *env)
- };
+     /* set proper signanling bit meaning ("1" means "quiet") */
- struct AspeedMachineState {
+     set_snan_bit_is_one(0, &env->active_tc.msa_fp_status);
 +    /* Private */
 +    MachineState parent_obj;
 +    /* Public */
 +
-     AspeedSoCState soc;
++    /* Inf * 0 + NaN returns the input NaN */
-     MemoryRegion ram_container;
++    set_float_infzeronan_rule(float_infzeronan_dnan_never,
-     MemoryRegion max_ram;
++                              &env->active_tc.msa_fp_status);
-+    bool mmio_exec;
+ }
- };
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
+index XXXXXXX..XXXXXXX 100644
- /* Palmetto hardware value: 0x120CE416 */
+--- a/fpu/softfloat-specialize.c.inc
-@@ -XXX,XX +XXX,XX @@ static void sdhci_attach_drive(SDHCIState *sdhci, DriveInfo *dinfo)
++++ b/fpu/softfloat-specialize.c.inc
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
- static void aspeed_machine_init(MachineState *machine)
+         /*
- {
+          * Temporarily fall back to ifdef ladder
--    AspeedMachineState *bmc;
+          */
-+    AspeedMachineState *bmc = ASPEED_MACHINE(machine);
+-#if defined(TARGET_MIPS)
-     AspeedMachineClass *amc = ASPEED_MACHINE_GET_CLASS(machine);
+-        if (snan_bit_is_one(status)) {
-     AspeedSoCClass *sc;
+-            /*
-     DriveInfo *drive0 = drive_get(IF_MTD, 0, 0);
+-             * For MIPS systems that conform to IEEE754-1985, the (inf,zero,nan)
-@@ -XXX,XX +XXX,XX @@ static void aspeed_machine_init(MachineState *machine)
+-             * case sets InvalidOp and returns the default NaN
-     int i;
+-             */
-     NICInfo *nd = &nd_table[0];
+-            rule = float_infzeronan_dnan_always;
+-        } else {
--    bmc = g_new0(AspeedMachineState, 1);
+-            /*
--
+-             * For MIPS systems that conform to IEEE754-2008, the (inf,zero,nan)
-     memory_region_init(&bmc->ram_container, NULL, "aspeed-ram-container",
+-             * case sets InvalidOp and returns the input value 'c'
-* GiB);
+-             */
-     memory_region_add_subregion(&bmc->ram_container, 0, machine->ram);
+-            rule = float_infzeronan_dnan_never;
-@@ -XXX,XX +XXX,XX @@ static const TypeInfo aspeed_machine_types[] = {
+-        }
-     }, {
+-#elif defined(TARGET_SPARC) || \
-         .name          = TYPE_ASPEED_MACHINE,
++#if defined(TARGET_SPARC) || \
-         .parent        = TYPE_MACHINE,
+     defined(TARGET_XTENSA) || defined(TARGET_HPPA) || \
--        .instance_size = sizeof(AspeedMachine),
+     defined(TARGET_I386) || defined(TARGET_LOONGARCH)
-+        .instance_size = sizeof(AspeedMachineState),
+         /*
          .instance_init = aspeed_machine_instance_init,
          .class_size    = sizeof(AspeedMachineClass),
          .class_init    = aspeed_machine_class_init,
 --
-.20.1
+.34.1

-New patch
+[PULL 14/72] target/sparc: Set FloatInfZeroNaNRule explicitly
+Set the FloatInfZeroNaNRule explicitly for the SPARC target,
+so we can remove the ifdef from pickNaNMulAdd().
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-10-peter.maydell@linaro.org
+---
+ target/sparc/cpu.c             | 2 ++
+ fpu/softfloat-specialize.c.inc | 3 +--
+files changed, 3 insertions(+), 2 deletions(-)
+diff --git a/target/sparc/cpu.c b/target/sparc/cpu.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/sparc/cpu.c
++++ b/target/sparc/cpu.c
+@@ -XXX,XX +XXX,XX @@ static void sparc_cpu_realizefn(DeviceState *dev, Error **errp)
+      * the CPU state struct so it won't get zeroed on reset.
+      */
+     set_float_2nan_prop_rule(float_2nan_prop_s_ba, &env->fp_status);
++    /* For inf * 0 + NaN, return the input NaN */
++    set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
+     cpu_exec_realizefn(cs, &local_err);
+     if (local_err != NULL) {
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
+index XXXXXXX..XXXXXXX 100644
+--- a/fpu/softfloat-specialize.c.inc
++++ b/fpu/softfloat-specialize.c.inc
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
+         /*
+          * Temporarily fall back to ifdef ladder
+          */
+-#if defined(TARGET_SPARC) || \
+-    defined(TARGET_XTENSA) || defined(TARGET_HPPA) || \
++#if defined(TARGET_XTENSA) || defined(TARGET_HPPA) || \
+     defined(TARGET_I386) || defined(TARGET_LOONGARCH)
+         /*
+          * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
+--
+.34.1

-New patch
+[PULL 15/72] target/xtensa: Set FloatInfZeroNaNRule explicitly
+Set the FloatInfZeroNaNRule explicitly for the xtensa target,
+so we can remove the ifdef from pickNaNMulAdd().
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-11-peter.maydell@linaro.org
+---
+ target/xtensa/cpu.c            | 2 ++
+ fpu/softfloat-specialize.c.inc | 2 +-
+files changed, 3 insertions(+), 1 deletion(-)
+diff --git a/target/xtensa/cpu.c b/target/xtensa/cpu.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/xtensa/cpu.c
++++ b/target/xtensa/cpu.c
+@@ -XXX,XX +XXX,XX @@ static void xtensa_cpu_reset_hold(Object *obj, ResetType type)
+     reset_mmu(env);
+     cs->halted = env->runstall;
+ #endif
++    /* For inf * 0 + NaN, return the input NaN */
++    set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
+     set_no_signaling_nans(!dfpu, &env->fp_status);
+     xtensa_use_first_nan(env, !dfpu);
+ }
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
+index XXXXXXX..XXXXXXX 100644
+--- a/fpu/softfloat-specialize.c.inc
++++ b/fpu/softfloat-specialize.c.inc
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
+         /*
+          * Temporarily fall back to ifdef ladder
+          */
+-#if defined(TARGET_XTENSA) || defined(TARGET_HPPA) || \
++#if defined(TARGET_HPPA) || \
+     defined(TARGET_I386) || defined(TARGET_LOONGARCH)
+         /*
+          * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
+--
+.34.1

-[PULL 56/57] target/arm: Add allocation tag storage for system mode
+[PULL 16/72] target/x86: Set FloatInfZeroNaNRule explicitly
-From: Richard Henderson <richard.henderson@linaro.org>
+Set the FloatInfZeroNaNRule explicitly for the x86 target.
-Look up the physical address for the given virtual address,
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-convert that to a tag physical address, and finally return
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-the host address that backs it.
+Message-id: 20241202131347.498124-12-peter.maydell@linaro.org
 ---
  target/i386/tcg/fpu_helper.c   | 7 +++++++
  fpu/softfloat-specialize.c.inc | 2 +-
 files changed, 8 insertions(+), 1 deletion(-)
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+diff --git a/target/i386/tcg/fpu_helper.c b/target/i386/tcg/fpu_helper.c
 Message-id: 20200626033144.790098-45-richard.henderson@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/mte_helper.c | 131 ++++++++++++++++++++++++++++++++++++++++
 file changed, 131 insertions(+)
 diff --git a/target/arm/mte_helper.c b/target/arm/mte_helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/mte_helper.c
+--- a/target/i386/tcg/fpu_helper.c
-+++ b/target/arm/mte_helper.c
++++ b/target/i386/tcg/fpu_helper.c
-@@ -XXX,XX +XXX,XX @@
+@@ -XXX,XX +XXX,XX @@ void cpu_init_fp_statuses(CPUX86State *env)
- #include "cpu.h"
+      */
- #include "internals.h"
+     set_float_2nan_prop_rule(float_2nan_prop_x87, &env->mmx_status);
- #include "exec/exec-all.h"
+     set_float_2nan_prop_rule(float_2nan_prop_x87, &env->sse_status);
 +#include "exec/ram_addr.h"
  #include "exec/cpu_ldst.h"
  #include "exec/helper-proto.h"
@@ -XXX,XX +XXX,XX @@ static uint8_t *allocation_tag_mem(CPUARMState *env, int ptr_mmu_idx,
                                     int ptr_size, MMUAccessType tag_access,
                                     int tag_size, uintptr_t ra)
  {
 +#ifdef CONFIG_USER_ONLY
      /* Tag storage not implemented.  */
      return NULL;
 +#else
 +    uintptr_t index;
 +    CPUIOTLBEntry *iotlbentry;
 +    int in_page, flags;
 +    ram_addr_t ptr_ra;
 +    hwaddr ptr_paddr, tag_paddr, xlat;
 +    MemoryRegion *mr;
 +    ARMASIdx tag_asi;
 +    AddressSpace *tag_as;
 +    void *host;
 +
 +    /*
-+     * Probe the first byte of the virtual address.  This raises an
++     * Only SSE has multiply-add instructions. In the SDM Section 14.5.2
-+     * exception for inaccessible pages, and resolves the virtual address
++     * "Fused-Multiply-ADD (FMA) Numeric Behavior" the NaN handling is
-+     * into the softmmu tlb.
++     * specified -- for 0 * inf + NaN the input NaN is selected, and if
-+     *
++     * there are multiple input NaNs they are selected in the order a, b, c.
 +     * When RA == 0, this is for mte_probe1.  The page is expected to be
 +     * valid.  Indicate to probe_access_flags no-fault, then assert that
 +     * we received a valid page.
 +     */
-+    flags = probe_access_flags(env, ptr, ptr_access, ptr_mmu_idx,
++    set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->sse_status);
 +                               ra == 0, &host, ra);
 +    assert(!(flags & TLB_INVALID_MASK));
 +
 +    /*
 +     * Find the iotlbentry for ptr.  This *must* be present in the TLB
 +     * because we just found the mapping.
 +     * TODO: Perhaps there should be a cputlb helper that returns a
 +     * matching tlb entry + iotlb entry.
 +     */
 +    index = tlb_index(env, ptr_mmu_idx, ptr);
 +# ifdef CONFIG_DEBUG_TCG
 +    {
 +        CPUTLBEntry *entry = tlb_entry(env, ptr_mmu_idx, ptr);
 +        target_ulong comparator = (ptr_access == MMU_DATA_LOAD
 +                                   ? entry->addr_read
 +                                   : tlb_addr_write(entry));
 +        g_assert(tlb_hit(comparator, ptr));
 +    }
 +# endif
 +    iotlbentry = &env_tlb(env)->d[ptr_mmu_idx].iotlb[index];
 +
 +    /* If the virtual page MemAttr != Tagged, access unchecked. */
 +    if (!arm_tlb_mte_tagged(&iotlbentry->attrs)) {
 +        return NULL;
 +    }
 +
 +    /*
 +     * If not backed by host ram, there is no tag storage: access unchecked.
 +     * This is probably a guest os bug though, so log it.
 +     */
 +    if (unlikely(flags & TLB_MMIO)) {
 +        qemu_log_mask(LOG_GUEST_ERROR,
 +                      "Page @ 0x%" PRIx64 " indicates Tagged Normal memory "
 +                      "but is not backed by host ram\n", ptr);
 +        return NULL;
 +    }
 +
 +    /*
 +     * The Normal memory access can extend to the next page.  E.g. a single
 +     * 8-byte access to the last byte of a page will check only the last
 +     * tag on the first page.
 +     * Any page access exception has priority over tag check exception.
 +     */
 +    in_page = -(ptr | TARGET_PAGE_MASK);
 +    if (unlikely(ptr_size > in_page)) {
 +        void *ignore;
 +        flags |= probe_access_flags(env, ptr + in_page, ptr_access,
 +                                    ptr_mmu_idx, ra == 0, &ignore, ra);
 +        assert(!(flags & TLB_INVALID_MASK));
 +    }
 +
 +    /* Any debug exception has priority over a tag check exception. */
 +    if (unlikely(flags & TLB_WATCHPOINT)) {
 +        int wp = ptr_access == MMU_DATA_LOAD ? BP_MEM_READ : BP_MEM_WRITE;
 +        assert(ra != 0);
 +        cpu_check_watchpoint(env_cpu(env), ptr, ptr_size,
 +                             iotlbentry->attrs, wp, ra);
 +    }
 +
 +    /*
 +     * Find the physical address within the normal mem space.
 +     * The memory region lookup must succeed because TLB_MMIO was
 +     * not set in the cputlb lookup above.
 +     */
 +    mr = memory_region_from_host(host, &ptr_ra);
 +    tcg_debug_assert(mr != NULL);
 +    tcg_debug_assert(memory_region_is_ram(mr));
 +    ptr_paddr = ptr_ra;
 +    do {
 +        ptr_paddr += mr->addr;
 +        mr = mr->container;
 +    } while (mr);
 +
 +    /* Convert to the physical address in tag space.  */
 +    tag_paddr = ptr_paddr >> (LOG2_TAG_GRANULE + 1);
 +
 +    /* Look up the address in tag space. */
 +    tag_asi = iotlbentry->attrs.secure ? ARMASIdx_TagS : ARMASIdx_TagNS;
 +    tag_as = cpu_get_address_space(env_cpu(env), tag_asi);
 +    mr = address_space_translate(tag_as, tag_paddr, &xlat, NULL,
 +                                 tag_access == MMU_DATA_STORE,
 +                                 iotlbentry->attrs);
 +
 +    /*
 +     * Note that @mr will never be NULL.  If there is nothing in the address
 +     * space at @tag_paddr, the translation will return the unallocated memory
 +     * region.  For our purposes, the result must be ram.
 +     */
 +    if (unlikely(!memory_region_is_ram(mr))) {
 +        /* ??? Failure is a board configuration error. */
 +        qemu_log_mask(LOG_UNIMP,
 +                      "Tag Memory @ 0x%" HWADDR_PRIx " not found for "
 +                      "Normal Memory @ 0x%" HWADDR_PRIx "\n",
 +                      tag_paddr, ptr_paddr);
 +        return NULL;
 +    }
 +
 +    /*
 +     * Ensure the tag memory is dirty on write, for migration.
 +     * Tag memory can never contain code or display memory (vga).
 +     */
 +    if (tag_access == MMU_DATA_STORE) {
 +        ram_addr_t tag_ra = memory_region_get_ram_addr(mr) + xlat;
 +        cpu_physical_memory_set_dirty_flag(tag_ra, DIRTY_MEMORY_MIGRATION);
 +    }
 +
 +    return memory_region_get_ram_ptr(mr) + xlat;
 +#endif
  }
- uint64_t HELPER(irg)(CPUARMState *env, uint64_t rn, uint64_t rm)
+ static inline uint8_t save_exception_flags(CPUX86State *env)
 diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 index XXXXXXX..XXXXXXX 100644
 --- a/fpu/softfloat-specialize.c.inc
 +++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
           * Temporarily fall back to ifdef ladder
           */
  #if defined(TARGET_HPPA) || \
 -    defined(TARGET_I386) || defined(TARGET_LOONGARCH)
 +    defined(TARGET_LOONGARCH)
          /*
           * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
           * case sets InvalidOp and returns the input value 'c'
 --
-.20.1
+.34.1

-[PULL 05/57] hw/misc/pca9552: Rename 'nr_leds' as 'pin_count'
+[PULL 17/72] target/loongarch: Set FloatInfZeroNaNRule explicitly
-From: Philippe Mathieu-Daudé <f4bug@amsat.org>
+Set the FloatInfZeroNaNRule explicitly for the loongarch target.
-The PCA9552 device does not expose LEDs, but simple pins
-to connnect LEDs to. To be clearer with the device model,
-rename 'nr_leds' as 'pin_count'.
-Reviewed-by: Cédric Le Goater <clg@kaod.org>
-Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
-Tested-by: Cédric Le Goater <clg@kaod.org>
-Message-id: 20200623072723.6324-3-f4bug@amsat.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-13-peter.maydell@linaro.org
 ---
- include/hw/misc/pca9552.h |  2 +-
+ target/loongarch/tcg/fpu_helper.c | 5 +++++
- hw/misc/pca9552.c         | 10 +++++-----
+ fpu/softfloat-specialize.c.inc    | 7 +------
 files changed, 6 insertions(+), 6 deletions(-)
-diff --git a/include/hw/misc/pca9552.h b/include/hw/misc/pca9552.h
+diff --git a/target/loongarch/tcg/fpu_helper.c b/target/loongarch/tcg/fpu_helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/include/hw/misc/pca9552.h
+--- a/target/loongarch/tcg/fpu_helper.c
-+++ b/include/hw/misc/pca9552.h
++++ b/target/loongarch/tcg/fpu_helper.c
-@@ -XXX,XX +XXX,XX @@ typedef struct PCA9552State {
+@@ -XXX,XX +XXX,XX @@ void restore_fp_status(CPULoongArchState *env)
+                             &env->fp_status);
-     uint8_t regs[PCA9552_NR_REGS];
+     set_flush_to_zero(0, &env->fp_status);
-     uint8_t max_reg;
+     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &env->fp_status);
--    uint8_t nr_leds;
++    /*
-+    uint8_t pin_count;
++     * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
- } PCA9552State;
++     * case sets InvalidOp and returns the input value 'c'
++     */
 +    set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
  }
  int ieee_ex_to_loongarch(int xcpt)
 diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 index XXXXXXX..XXXXXXX 100644
 --- a/fpu/softfloat-specialize.c.inc
 +++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
          /*
           * Temporarily fall back to ifdef ladder
           */
 -#if defined(TARGET_HPPA) || \
 -    defined(TARGET_LOONGARCH)
 -        /*
 -         * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
 -         * case sets InvalidOp and returns the input value 'c'
 -         */
 +#if defined(TARGET_HPPA)
          rule = float_infzeronan_dnan_never;
  #endif
-diff --git a/hw/misc/pca9552.c b/hw/misc/pca9552.c
-index XXXXXXX..XXXXXXX 100644
---- a/hw/misc/pca9552.c
-+++ b/hw/misc/pca9552.c
-@@ -XXX,XX +XXX,XX @@ static void pca9552_update_pin_input(PCA9552State *s)
- {
-     int i;
--    for (i = 0; i < s->nr_leds; i++) {
-+    for (i = 0; i < s->pin_count; i++) {
-         uint8_t input_reg = PCA9552_INPUT0 + (i / 8);
-         uint8_t input_shift = (i % 8);
-         uint8_t config = pca9552_pin_get_config(s, i);
-@@ -XXX,XX +XXX,XX @@ static void pca9552_get_led(Object *obj, Visitor *v, const char *name,
-         error_setg(errp, "%s: error reading %s", __func__, name);
-         return;
      }
--    if (led < 0 || led > s->nr_leds) {
-+    if (led < 0 || led > s->pin_count) {
-         error_setg(errp, "%s invalid led %s", __func__, name);
-         return;
-     }
-@@ -XXX,XX +XXX,XX @@ static void pca9552_set_led(Object *obj, Visitor *v, const char *name,
-         error_setg(errp, "%s: error reading %s", __func__, name);
-         return;
-     }
--    if (led < 0 || led > s->nr_leds) {
-+    if (led < 0 || led > s->pin_count) {
-         error_setg(errp, "%s invalid led %s", __func__, name);
-         return;
-     }
-@@ -XXX,XX +XXX,XX @@ static void pca9552_initfn(Object *obj)
-      * PCA955X device
-      */
-     s->max_reg = PCA9552_LS3;
--    s->nr_leds = 16;
-+    s->pin_count = 16;
--    for (led = 0; led < s->nr_leds; led++) {
-+    for (led = 0; led < s->pin_count; led++) {
-         char *name;
-         name = g_strdup_printf("led%d", led);
 --
-.20.1
+.34.1

-[PULL 39/57] target/arm: Add helper_mte_check_zva
+[PULL 18/72] target/hppa: Set FloatInfZeroNaNRule explicitly
-From: Richard Henderson <richard.henderson@linaro.org>
+Set the FloatInfZeroNaNRule explicitly for the HPPA target,
 so we can remove the ifdef from pickNaNMulAdd().
-Use a special helper for DC_ZVA, rather than the more
+As this is the last target to be converted to explicitly setting
-general mte_checkN.
+the rule, we can remove the fallback code in pickNaNMulAdd()
 entirely.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20200626033144.790098-28-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-14-peter.maydell@linaro.org
 ---
- target/arm/helper-a64.h    |   1 +
+ target/hppa/fpu_helper.c       |  2 ++
- target/arm/mte_helper.c    | 106 +++++++++++++++++++++++++++++++++++++
+ fpu/softfloat-specialize.c.inc | 13 +------------
- target/arm/translate-a64.c |  16 +++++-
+files changed, 3 insertions(+), 12 deletions(-)
 files changed, 122 insertions(+), 1 deletion(-)
-diff --git a/target/arm/helper-a64.h b/target/arm/helper-a64.h
+diff --git a/target/hppa/fpu_helper.c b/target/hppa/fpu_helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-a64.h
+--- a/target/hppa/fpu_helper.c
-+++ b/target/arm/helper-a64.h
++++ b/target/hppa/fpu_helper.c
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_2(xpacd, TCG_CALL_NO_RWG_SE, i64, env, i64)
+@@ -XXX,XX +XXX,XX @@ void HELPER(loaded_fr0)(CPUHPPAState *env)
+      * HPPA does note implement a CPU reset method at all...
- DEF_HELPER_FLAGS_3(mte_check1, TCG_CALL_NO_WG, i64, env, i32, i64)
+      */
- DEF_HELPER_FLAGS_3(mte_checkN, TCG_CALL_NO_WG, i64, env, i32, i64)
+     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &env->fp_status);
-+DEF_HELPER_FLAGS_3(mte_check_zva, TCG_CALL_NO_WG, i64, env, i32, i64)
++    /* For inf * 0 + NaN, return the input NaN */
- DEF_HELPER_FLAGS_3(irg, TCG_CALL_NO_RWG, i64, env, i64, i64)
++    set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
- DEF_HELPER_FLAGS_4(addsubg, TCG_CALL_NO_RWG_SE, i64, env, i64, s32, i32)
+ }
- DEF_HELPER_FLAGS_3(ldg, TCG_CALL_NO_WG, i64, env, i64, i64)
-diff --git a/target/arm/mte_helper.c b/target/arm/mte_helper.c
+ void cpu_hppa_loaded_fr0(CPUHPPAState *env)
 diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/mte_helper.c
+--- a/fpu/softfloat-specialize.c.inc
-+++ b/target/arm/mte_helper.c
++++ b/fpu/softfloat-specialize.c.inc
-@@ -XXX,XX +XXX,XX @@ uint64_t HELPER(mte_checkN)(CPUARMState *env, uint32_t desc, uint64_t ptr)
+@@ -XXX,XX +XXX,XX @@ static int pickNaN(FloatClass a_cls, FloatClass b_cls,
  static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
                           bool infzero, float_status *status)
  {
-     return mte_checkN(env, desc, ptr, GETPC());
+-    FloatInfZeroNaNRule rule = status->float_infzeronan_rule;
- }
+-
-+
+     /*
-+/*
+      * We guarantee not to require the target to tell us how to
-+ * Perform an MTE checked access for DC_ZVA.
+      * pick a NaN if we're always returning the default NaN.
-+ */
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
-+uint64_t HELPER(mte_check_zva)(CPUARMState *env, uint32_t desc, uint64_t ptr)
+      */
-+{
+     assert(!status->default_nan_mode);
-+    uintptr_t ra = GETPC();
-+    int log2_dcz_bytes, log2_tag_bytes;
+-    if (rule == float_infzeronan_none) {
-+    int mmu_idx, bit55;
+-        /*
-+    intptr_t dcz_bytes, tag_bytes, i;
+-         * Temporarily fall back to ifdef ladder
-+    void *mem;
+-         */
-+    uint64_t ptr_tag, mem_tag, align_ptr;
+-#if defined(TARGET_HPPA)
-+
+-        rule = float_infzeronan_dnan_never;
-+    bit55 = extract64(ptr, 55, 1);
+-#endif
-+
+-    }
-+    /* If TBI is disabled, the access is unchecked, and ptr is not dirty. */
+-
-+    if (unlikely(!tbi_check(desc, bit55))) {
+     if (infzero) {
-+        return ptr;
+         /*
-+    }
+          * Inf * 0 + NaN -- some implementations return the default NaN here,
-+
+          * and some return the input NaN.
-+    ptr_tag = allocation_tag_from_addr(ptr);
+          */
-+
+-        switch (rule) {
-+    if (tcma_check(desc, bit55, ptr_tag)) {
++        switch (status->float_infzeronan_rule) {
-+        goto done;
+         case float_infzeronan_dnan_never:
-+    }
+             return 2;
-+
+         case float_infzeronan_dnan_always:
 +    /*
 +     * In arm_cpu_realizefn, we asserted that dcz > LOG2_TAG_GRANULE+1,
 +     * i.e. 32 bytes, which is an unreasonably small dcz anyway, to make
 +     * sure that we can access one complete tag byte here.
 +     */
 +    log2_dcz_bytes = env_archcpu(env)->dcz_blocksize + 2;
 +    log2_tag_bytes = log2_dcz_bytes - (LOG2_TAG_GRANULE + 1);
 +    dcz_bytes = (intptr_t)1 << log2_dcz_bytes;
 +    tag_bytes = (intptr_t)1 << log2_tag_bytes;
 +    align_ptr = ptr & -dcz_bytes;
 +
 +    /*
 +     * Trap if accessing an invalid page.  DC_ZVA requires that we supply
 +     * the original pointer for an invalid page.  But watchpoints require
 +     * that we probe the actual space.  So do both.
 +     */
 +    mmu_idx = FIELD_EX32(desc, MTEDESC, MIDX);
 +    (void) probe_write(env, ptr, 1, mmu_idx, ra);
 +    mem = allocation_tag_mem(env, mmu_idx, align_ptr, MMU_DATA_STORE,
 +                             dcz_bytes, MMU_DATA_LOAD, tag_bytes, ra);
 +    if (!mem) {
 +        goto done;
 +    }
 +
 +    /*
 +     * Unlike the reasoning for checkN, DC_ZVA is always aligned, and thus
 +     * it is quite easy to perform all of the comparisons at once without
 +     * any extra masking.
 +     *
 +     * The most common zva block size is 64; some of the thunderx cpus use
 +     * a block size of 128.  For user-only, aarch64_max_initfn will set the
 +     * block size to 512.  Fill out the other cases for future-proofing.
 +     *
 +     * In order to be able to find the first miscompare later, we want the
 +     * tag bytes to be in little-endian order.
 +     */
 +    switch (log2_tag_bytes) {
 +    case 0: /* zva_blocksize 32 */
 +        mem_tag = *(uint8_t *)mem;
 +        ptr_tag *= 0x11u;
 +        break;
 +    case 1: /* zva_blocksize 64 */
 +        mem_tag = cpu_to_le16(*(uint16_t *)mem);
 +        ptr_tag *= 0x1111u;
 +        break;
 +    case 2: /* zva_blocksize 128 */
 +        mem_tag = cpu_to_le32(*(uint32_t *)mem);
 +        ptr_tag *= 0x11111111u;
 +        break;
 +    case 3: /* zva_blocksize 256 */
 +        mem_tag = cpu_to_le64(*(uint64_t *)mem);
 +        ptr_tag *= 0x1111111111111111ull;
 +        break;
 +
 +    default: /* zva_blocksize 512, 1024, 2048 */
 +        ptr_tag *= 0x1111111111111111ull;
 +        i = 0;
 +        do {
 +            mem_tag = cpu_to_le64(*(uint64_t *)(mem + i));
 +            if (unlikely(mem_tag != ptr_tag)) {
 +                goto fail;
 +            }
 +            i += 8;
 +            align_ptr += 16 * TAG_GRANULE;
 +        } while (i < tag_bytes);
 +        goto done;
 +    }
 +
 +    if (likely(mem_tag == ptr_tag)) {
 +        goto done;
 +    }
 +
 + fail:
 +    /* Locate the first nibble that differs. */
 +    i = ctz64(mem_tag ^ ptr_tag) >> 4;
 +    mte_check_fail(env, mmu_idx, align_ptr + i * TAG_GRANULE, ra);
 +
 + done:
 +    return useronly_clean_ptr(ptr);
 +}
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void handle_sys(DisasContext *s, uint32_t insn, bool isread,
          return;
      case ARM_CP_DC_ZVA:
          /* Writes clear the aligned block of memory which rt points into. */
 -        tcg_rt = clean_data_tbi(s, cpu_reg(s, rt));
 +        if (s->mte_active[0]) {
 +            TCGv_i32 t_desc;
 +            int desc = 0;
 +
 +            desc = FIELD_DP32(desc, MTEDESC, MIDX, get_mem_index(s));
 +            desc = FIELD_DP32(desc, MTEDESC, TBI, s->tbid);
 +            desc = FIELD_DP32(desc, MTEDESC, TCMA, s->tcma);
 +            t_desc = tcg_const_i32(desc);
 +
 +            tcg_rt = new_tmp_a64(s);
 +            gen_helper_mte_check_zva(tcg_rt, cpu_env, t_desc, cpu_reg(s, rt));
 +            tcg_temp_free_i32(t_desc);
 +        } else {
 +            tcg_rt = clean_data_tbi(s, cpu_reg(s, rt));
 +        }
          gen_helper_dc_zva(cpu_env, tcg_rt);
          return;
      default:
 --
-.20.1
+.34.1

-[PULL 54/57] target/arm: Cache the Tagged bit for a page in MemTxAttrs
+[PULL 19/72] softfloat: Pass have_snan to pickNaNMulAdd
-From: Richard Henderson <richard.henderson@linaro.org>
+The new implementation of pickNaNMulAdd() will find it convenient
 to know whether at least one of the three arguments to the muladd
 was a signaling NaN. We already calculate that in the caller,
 so pass it in as a new bool have_snan.
-This "bit" is a particular value of the page's MemAttr.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20241202131347.498124-15-peter.maydell@linaro.org
 ---
  fpu/softfloat-parts.c.inc      | 5 +++--
  fpu/softfloat-specialize.c.inc | 2 +-
 files changed, 4 insertions(+), 3 deletions(-)
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20200626033144.790098-43-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/helper.c     | 48 ++++++++++++++++++++++++++++++++++++++---
  target/arm/tlb_helper.c |  5 +++++
 files changed, 50 insertions(+), 3 deletions(-)
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/fpu/softfloat-parts.c.inc
-+++ b/target/arm/helper.c
++++ b/fpu/softfloat-parts.c.inc
-@@ -XXX,XX +XXX,XX @@ static uint8_t combine_cacheattr_nibble(uint8_t s1, uint8_t s2)
+@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
   */
  static ARMCacheAttrs combine_cacheattrs(ARMCacheAttrs s1, ARMCacheAttrs s2)
  {
--    uint8_t s1lo = extract32(s1.attrs, 0, 4), s2lo = extract32(s2.attrs, 0, 4);
+     int which;
--    uint8_t s1hi = extract32(s1.attrs, 4, 4), s2hi = extract32(s2.attrs, 4, 4);
+     bool infzero = (ab_mask == float_cmask_infzero);
-+    uint8_t s1lo, s2lo, s1hi, s2hi;
++    bool have_snan = (abc_mask & float_cmask_snan);
-     ARMCacheAttrs ret;
-+    bool tagged = false;
+-    if (unlikely(abc_mask & float_cmask_snan)) {
-+
++    if (unlikely(have_snan)) {
-+    if (s1.attrs == 0xf0) {
+         float_raise(float_flag_invalid | float_flag_invalid_snan, s);
 +        tagged = true;
 +        s1.attrs = 0xff;
 +    }
 +
 +    s1lo = extract32(s1.attrs, 0, 4);
 +    s2lo = extract32(s2.attrs, 0, 4);
 +    s1hi = extract32(s1.attrs, 4, 4);
 +    s2hi = extract32(s2.attrs, 4, 4);
      /* Combine shareability attributes (table D4-43) */
      if (s1.shareability == 2 || s2.shareability == 2) {
@@ -XXX,XX +XXX,XX @@ static ARMCacheAttrs combine_cacheattrs(ARMCacheAttrs s1, ARMCacheAttrs s2)
          }
      }
-+    /* TODO: CombineS1S2Desc does not consider transient, only WB, RWA. */
+@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
-+    if (tagged && ret.attrs == 0xff) {
+     if (s->default_nan_mode) {
-+        ret.attrs = 0xf0;
+         which = 3;
-+    }
+     } else {
-+
+-        which = pickNaNMulAdd(a->cls, b->cls, c->cls, infzero, s);
-     return ret;
++        which = pickNaNMulAdd(a->cls, b->cls, c->cls, infzero, have_snan, s);
  }
@@ -XXX,XX +XXX,XX @@ bool get_phys_addr(CPUARMState *env, target_ulong address,
                   *  Normal Non-Shareable,
                   *  Inner Write-Back Read-Allocate Write-Allocate,
                   *  Outer Write-Back Read-Allocate Write-Allocate.
 +                 * Do not overwrite Tagged within attrs.
                   */
 -                cacheattrs->attrs = 0xff;
 +                if (cacheattrs->attrs != 0xf0) {
 +                    cacheattrs->attrs = 0xff;
 +                }
                  cacheattrs->shareability = 0;
              }
              *cacheattrs = combine_cacheattrs(*cacheattrs, cacheattrs2);
@@ -XXX,XX +XXX,XX @@ bool get_phys_addr(CPUARMState *env, target_ulong address,
      /* Definitely a real MMU, not an MPU */
      if (regime_translation_disabled(env, mmu_idx)) {
 +        uint64_t hcr;
 +        uint8_t memattr;
 +
          /*
           * MMU disabled.  S1 addresses within aa64 translation regimes are
           * still checked for bounds -- see AArch64.TranslateAddressS1Off.
@@ -XXX,XX +XXX,XX @@ bool get_phys_addr(CPUARMState *env, target_ulong address,
          *phys_ptr = address;
          *prot = PAGE_READ | PAGE_WRITE | PAGE_EXEC;
          *page_size = TARGET_PAGE_SIZE;
 +
 +        /* Fill in cacheattr a-la AArch64.TranslateAddressS1Off. */
 +        hcr = arm_hcr_el2_eff(env);
 +        cacheattrs->shareability = 0;
 +        if (hcr & HCR_DC) {
 +            if (hcr & HCR_DCT) {
 +                memattr = 0xf0;  /* Tagged, Normal, WB, RWA */
 +            } else {
 +                memattr = 0xff;  /* Normal, WB, RWA */
 +            }
 +        } else if (access_type == MMU_INST_FETCH) {
 +            if (regime_sctlr(env, mmu_idx) & SCTLR_I) {
 +                memattr = 0xee;  /* Normal, WT, RA, NT */
 +            } else {
 +                memattr = 0x44;  /* Normal, NC, No */
 +            }
 +            cacheattrs->shareability = 2; /* outer sharable */
 +        } else {
 +            memattr = 0x00;      /* Device, nGnRnE */
 +        }
 +        cacheattrs->attrs = memattr;
          return 0;
      }
-diff --git a/target/arm/tlb_helper.c b/target/arm/tlb_helper.c
+     if (which == 3) {
 diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/tlb_helper.c
+--- a/fpu/softfloat-specialize.c.inc
-+++ b/target/arm/tlb_helper.c
++++ b/fpu/softfloat-specialize.c.inc
-@@ -XXX,XX +XXX,XX @@ bool arm_cpu_tlb_fill(CPUState *cs, vaddr address, int size,
+@@ -XXX,XX +XXX,XX @@ static int pickNaN(FloatClass a_cls, FloatClass b_cls,
-             phys_addr &= TARGET_PAGE_MASK;
+ | Return values : 0 : a; 1 : b; 2 : c; 3 : default-NaN
-             address &= TARGET_PAGE_MASK;
+ *----------------------------------------------------------------------------*/
-         }
+ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
-+        /* Notice and record tagged memory. */
+-                         bool infzero, float_status *status)
-+        if (cpu_isar_feature(aa64_mte, cpu) && cacheattrs.attrs == 0xf0) {
++                         bool infzero, bool have_snan, float_status *status)
-+            arm_tlb_mte_tagged(&attrs) = true;
+ {
-+        }
+     /*
-+
+      * We guarantee not to require the target to tell us how to
          tlb_set_page_with_attrs(cs, address, phys_addr, attrs,
                                  prot, mmu_idx, page_size);
          return true;
 --
-.20.1
+.34.1

-[PULL 20/57] target/arm: Add MTE bits to tb_flags
+[PULL 20/72] softfloat: Allow runtime choice of NaN propagation for muladd
-From: Richard Henderson <richard.henderson@linaro.org>
+IEEE 758 does not define a fixed rule for which NaN to pick as the
+result if both operands of a 3-operand fused multiply-add operation
-Cache the composite ATA setting.
+are NaNs.  As a result different architectures have ended up with
+different rules for propagating NaNs.
-Cache when MTE is fully enabled, i.e. access to tags are enabled
-and tag checks affect the PE.  Do this for both the normal context
+QEMU currently hardcodes the NaN propagation logic into the binary
-and the UNPRIV context.
+because pickNaNMulAdd() has an ifdef ladder for different targets.
+We want to make the propagation rule instead be selectable at
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+runtime, because:
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+ * this will let us have multiple targets in one QEMU binary
-Message-id: 20200626033144.790098-9-richard.henderson@linaro.org
+ * the Arm FEAT_AFP architectural feature includes letting
    the guest select a NaN propagation rule at runtime
 In this commit we add an enum for the propagation rule, the field in
 float_status, and the corresponding getters and setters.  We change
 pickNaNMulAdd to honour this, but because all targets still leave
 this field at its default 0 value, the fallback logic will pick the
 rule type with the old ifdef ladder.
 It's valid not to set a propagation rule if default_nan_mode is
 enabled, because in that case there's no need to pick a NaN; all the
 callers of pickNaNMulAdd() catch this case and skip calling it.
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-16-peter.maydell@linaro.org
 ---
- target/arm/cpu.h           | 12 ++++++++----
+ include/fpu/softfloat-helpers.h |  11 +++
- target/arm/internals.h     | 18 +++++++++++++++++
+ include/fpu/softfloat-types.h   |  55 +++++++++++
- target/arm/translate.h     |  5 +++++
+ fpu/softfloat-specialize.c.inc  | 167 ++++++++------------------------
- target/arm/helper.c        | 40 ++++++++++++++++++++++++++++++++++++++
+files changed, 107 insertions(+), 126 deletions(-)
- target/arm/translate-a64.c |  4 ++++
-files changed, 75 insertions(+), 4 deletions(-)
+diff --git a/include/fpu/softfloat-helpers.h b/include/fpu/softfloat-helpers.h
 diff --git a/target/arm/cpu.h b/target/arm/cpu.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/include/fpu/softfloat-helpers.h
-+++ b/target/arm/cpu.h
++++ b/include/fpu/softfloat-helpers.h
-@@ -XXX,XX +XXX,XX @@ typedef ARMCPU ArchCPU;
+@@ -XXX,XX +XXX,XX @@ static inline void set_float_2nan_prop_rule(Float2NaNPropRule rule,
-  * |              |     |   TBFLAG_A32   |              |
+     status->float_2nan_prop_rule = rule;
-  * |              |     +-----+----------+  TBFLAG_AM32 |
+ }
-  * |  TBFLAG_ANY  |           |TBFLAG_M32|              |
-- * |              |         +-+----------+--------------|
++static inline void set_float_3nan_prop_rule(Float3NaNPropRule rule,
-- * |              |         |         TBFLAG_A64        |
++                                            float_status *status)
-- * +--------------+---------+---------------------------+
++{
-- *  31          20        15                           0
++    status->float_3nan_prop_rule = rule;
-+ * |              +-----------+----------+--------------|
++}
-+ * |              |            TBFLAG_A64               |
++
-+ * +--------------+-------------------------------------+
+ static inline void set_float_infzeronan_rule(FloatInfZeroNaNRule rule,
-+ *  31          20                                     0
+                                              float_status *status)
-  *
+ {
-  * Unless otherwise noted, these bits are cached in env->hflags.
+@@ -XXX,XX +XXX,XX @@ static inline Float2NaNPropRule get_float_2nan_prop_rule(float_status *status)
      return status->float_2nan_prop_rule;
  }
 +static inline Float3NaNPropRule get_float_3nan_prop_rule(float_status *status)
 +{
 +    return status->float_3nan_prop_rule;
 +}
 +
  static inline FloatInfZeroNaNRule get_float_infzeronan_rule(float_status *status)
  {
      return status->float_infzeronan_rule;
 diff --git a/include/fpu/softfloat-types.h b/include/fpu/softfloat-types.h
 index XXXXXXX..XXXXXXX 100644
 --- a/include/fpu/softfloat-types.h
 +++ b/include/fpu/softfloat-types.h
@@ -XXX,XX +XXX,XX @@ this code that are retained.
  #ifndef SOFTFLOAT_TYPES_H
  #define SOFTFLOAT_TYPES_H
 +#include "hw/registerfields.h"
 +
  /*
   * Software IEC/IEEE floating-point types.
   */
-@@ -XXX,XX +XXX,XX @@ FIELD(TBFLAG_A64, BT, 9, 1)
+@@ -XXX,XX +XXX,XX @@ typedef enum __attribute__((__packed__)) {
- FIELD(TBFLAG_A64, BTYPE, 10, 2)         /* Not cached. */
+     float_2nan_prop_x87,
- FIELD(TBFLAG_A64, TBID, 12, 2)
+ } Float2NaNPropRule;
- FIELD(TBFLAG_A64, UNPRIV, 14, 1)
-+FIELD(TBFLAG_A64, ATA, 15, 1)
++/*
-+FIELD(TBFLAG_A64, TCMA, 16, 2)
++ * 3-input NaN propagation rule, for fused multiply-add. Individual
-+FIELD(TBFLAG_A64, MTE_ACTIVE, 18, 1)
++ * architectures have different rules for which input NaN is
-+FIELD(TBFLAG_A64, MTE0_ACTIVE, 19, 1)
++ * propagated to the output when there is more than one NaN on the
++ * input.
- /**
++ *
-  * cpu_mmu_index:
++ * If default_nan_mode is enabled then it is valid not to set a NaN
-diff --git a/target/arm/internals.h b/target/arm/internals.h
++ * propagation rule, because the softfloat code guarantees not to try
 + * to pick a NaN to propagate in default NaN mode.  When not in
 + * default-NaN mode, it is an error for the target not to set the rule
 + * in float_status if it uses a muladd, and we will assert if we need
 + * to handle an input NaN and no rule was selected.
 + *
 + * The naming scheme for Float3NaNPropRule values is:
 + *  float_3nan_prop_s_abc:
 + *    = "Prefer SNaN over QNaN, then operand A over B over C"
 + *  float_3nan_prop_abc:
 + *    = "Prefer A over B over C regardless of SNaN vs QNAN"
 + *
 + * For QEMU, the multiply-add operation is A * B + C.
 + */
 +
 +/*
 + * We set the Float3NaNPropRule enum values up so we can select the
 + * right value in pickNaNMulAdd in a data driven way.
 + */
 +FIELD(3NAN, 1ST, 0, 2)   /* which operand is most preferred ? */
 +FIELD(3NAN, 2ND, 2, 2)   /* which operand is next most preferred ? */
 +FIELD(3NAN, 3RD, 4, 2)   /* which operand is least preferred ? */
 +FIELD(3NAN, SNAN, 6, 1)  /* do we prefer SNaN over QNaN ? */
 +
 +#define PROPRULE(X, Y, Z) \
 +    ((X << R_3NAN_1ST_SHIFT) | (Y << R_3NAN_2ND_SHIFT) | (Z << R_3NAN_3RD_SHIFT))
 +
 +typedef enum __attribute__((__packed__)) {
 +    float_3nan_prop_none = 0,     /* No propagation rule specified */
 +    float_3nan_prop_abc = PROPRULE(0, 1, 2),
 +    float_3nan_prop_acb = PROPRULE(0, 2, 1),
 +    float_3nan_prop_bac = PROPRULE(1, 0, 2),
 +    float_3nan_prop_bca = PROPRULE(1, 2, 0),
 +    float_3nan_prop_cab = PROPRULE(2, 0, 1),
 +    float_3nan_prop_cba = PROPRULE(2, 1, 0),
 +    float_3nan_prop_s_abc = float_3nan_prop_abc | R_3NAN_SNAN_MASK,
 +    float_3nan_prop_s_acb = float_3nan_prop_acb | R_3NAN_SNAN_MASK,
 +    float_3nan_prop_s_bac = float_3nan_prop_bac | R_3NAN_SNAN_MASK,
 +    float_3nan_prop_s_bca = float_3nan_prop_bca | R_3NAN_SNAN_MASK,
 +    float_3nan_prop_s_cab = float_3nan_prop_cab | R_3NAN_SNAN_MASK,
 +    float_3nan_prop_s_cba = float_3nan_prop_cba | R_3NAN_SNAN_MASK,
 +} Float3NaNPropRule;
 +
 +#undef PROPRULE
 +
  /*
   * Rule for result of fused multiply-add 0 * Inf + NaN.
   * This must be a NaN, but implementations differ on whether this
@@ -XXX,XX +XXX,XX @@ typedef struct float_status {
      FloatRoundMode float_rounding_mode;
      FloatX80RoundPrec floatx80_rounding_precision;
      Float2NaNPropRule float_2nan_prop_rule;
 +    Float3NaNPropRule float_3nan_prop_rule;
      FloatInfZeroNaNRule float_infzeronan_rule;
      bool tininess_before_rounding;
      /* should denormalised results go to zero and set the inexact flag? */
 diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/internals.h
+--- a/fpu/softfloat-specialize.c.inc
-+++ b/target/arm/internals.h
++++ b/fpu/softfloat-specialize.c.inc
-@@ -XXX,XX +XXX,XX @@ static inline int exception_target_el(CPUARMState *env)
+@@ -XXX,XX +XXX,XX @@ static int pickNaN(FloatClass a_cls, FloatClass b_cls,
-     return target_el;
+ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
- }
+                          bool infzero, bool have_snan, float_status *status)
 +/* Determine if allocation tags are available.  */
 +static inline bool allocation_tag_access_enabled(CPUARMState *env, int el,
 +                                                 uint64_t sctlr)
 +{
 +    if (el < 3
 +        && arm_feature(env, ARM_FEATURE_EL3)
 +        && !(env->cp15.scr_el3 & SCR_ATA)) {
 +        return false;
 +    }
 +    if (el < 2
 +        && arm_feature(env, ARM_FEATURE_EL2)
 +        && !(arm_hcr_el2_eff(env) & HCR_ATA)) {
 +        return false;
 +    }
 +    sctlr &= (el == 0 ? SCTLR_ATA0 : SCTLR_ATA);
 +    return sctlr != 0;
 +}
 +
  #ifndef CONFIG_USER_ONLY
  /* Security attributes for an address, as returned by v8m_security_lookup. */
 diff --git a/target/arm/translate.h b/target/arm/translate.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.h
 +++ b/target/arm/translate.h
@@ -XXX,XX +XXX,XX @@ typedef struct DisasContext {
      ARMMMUIdx mmu_idx; /* MMU index to use for normal loads/stores */
      uint8_t tbii;      /* TBI1|TBI0 for insns */
      uint8_t tbid;      /* TBI1|TBI0 for data */
 +    uint8_t tcma;      /* TCMA1|TCMA0 for MTE */
      bool ns;        /* Use non-secure CPREG bank on access */
      int fp_excp_el; /* FP exception EL or 0 if enabled */
      int sve_excp_el; /* SVE exception EL or 0 if enabled */
@@ -XXX,XX +XXX,XX @@ typedef struct DisasContext {
      bool unpriv;
      /* True if v8.3-PAuth is active.  */
      bool pauth_active;
 +    /* True if v8.5-MTE access to tags is enabled.  */
 +    bool ata;
 +    /* True if v8.5-MTE tag checks affect the PE; index with is_unpriv.  */
 +    bool mte_active[2];
      /* True with v8.5-BTI and SCTLR_ELx.BT* set.  */
      bool bt;
      /* True if any CP15 access is trapped by HSTR_EL2 */
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static int aa64_va_parameter_tbid(uint64_t tcr, ARMMMUIdx mmu_idx)
      }
  }
 +static int aa64_va_parameter_tcma(uint64_t tcr, ARMMMUIdx mmu_idx)
 +{
 +    if (regime_has_2_ranges(mmu_idx)) {
 +        return extract64(tcr, 57, 2);
 +    } else {
 +        /* Replicate the single TCMA bit so we always have 2 bits.  */
 +        return extract32(tcr, 30, 1) * 3;
 +    }
 +}
 +
  ARMVAParameters aa64_va_parameters(CPUARMState *env, uint64_t va,
                                     ARMMMUIdx mmu_idx, bool data)
  {
-@@ -XXX,XX +XXX,XX @@ static uint32_t rebuild_hflags_a64(CPUARMState *env, int el, int fp_el,
++    FloatClass cls[3] = { a_cls, b_cls, c_cls };
 +    Float3NaNPropRule rule = status->float_3nan_prop_rule;
 +    int which;
 +
      /*
       * We guarantee not to require the target to tell us how to
       * pick a NaN if we're always returning the default NaN.
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
          }
      }
-+    if (cpu_isar_feature(aa64_mte, env_archcpu(env))) {
++    if (rule == float_3nan_prop_none) {
  #if defined(TARGET_ARM)
 -
 -    /* This looks different from the ARM ARM pseudocode, because the ARM ARM
 -     * puts the operands to a fused mac operation (a*b)+c in the order c,a,b.
 -     */
 -    if (is_snan(c_cls)) {
 -        return 2;
 -    } else if (is_snan(a_cls)) {
 -        return 0;
 -    } else if (is_snan(b_cls)) {
 -        return 1;
 -    } else if (is_qnan(c_cls)) {
 -        return 2;
 -    } else if (is_qnan(a_cls)) {
 -        return 0;
 -    } else {
 -        return 1;
 -    }
 +        /*
-+         * Set MTE_ACTIVE if any access may be Checked, and leave clear
++         * This looks different from the ARM ARM pseudocode, because the ARM ARM
-+         * if all accesses must be Unchecked:
++         * puts the operands to a fused mac operation (a*b)+c in the order c,a,b
 +         * 1) If no TBI, then there are no tags in the address to check,
 +         * 2) If Tag Check Override, then all accesses are Unchecked,
 +         * 3) If Tag Check Fail == 0, then Checked access have no effect,
 +         * 4) If no Allocation Tag Access, then all accesses are Unchecked.
 +         */
-+        if (allocation_tag_access_enabled(env, el, sctlr)) {
++        rule = float_3nan_prop_s_cab;
-+            flags = FIELD_DP32(flags, TBFLAG_A64, ATA, 1);
+ #elif defined(TARGET_MIPS)
-+            if (tbid
+-    if (snan_bit_is_one(status)) {
-+                && !(env->pstate & PSTATE_TCO)
+-        /* Prefer sNaN over qNaN, in the a, b, c order. */
-+                && (sctlr & (el == 0 ? SCTLR_TCF0 : SCTLR_TCF))) {
+-        if (is_snan(a_cls)) {
-+                flags = FIELD_DP32(flags, TBFLAG_A64, MTE_ACTIVE, 1);
+-            return 0;
-+            }
+-        } else if (is_snan(b_cls)) {
-+        }
+-            return 1;
-+        /* And again for unprivileged accesses, if required.  */
+-        } else if (is_snan(c_cls)) {
-+        if (FIELD_EX32(flags, TBFLAG_A64, UNPRIV)
+-            return 2;
-+            && tbid
+-        } else if (is_qnan(a_cls)) {
-+            && !(env->pstate & PSTATE_TCO)
+-            return 0;
-+            && (sctlr & SCTLR_TCF0)
+-        } else if (is_qnan(b_cls)) {
-+            && allocation_tag_access_enabled(env, 0, sctlr)) {
+-            return 1;
-+            flags = FIELD_DP32(flags, TBFLAG_A64, MTE0_ACTIVE, 1);
++        if (snan_bit_is_one(status)) {
-+        }
++            rule = float_3nan_prop_s_abc;
-+        /* Cache TCMA as well as TBI. */
+         } else {
-+        flags = FIELD_DP32(flags, TBFLAG_A64, TCMA,
+-            return 2;
-+                           aa64_va_parameter_tcma(tcr, mmu_idx));
++            rule = float_3nan_prop_s_cab;
          }
 -    } else {
 -        /* Prefer sNaN over qNaN, in the c, a, b order. */
 -        if (is_snan(c_cls)) {
 -            return 2;
 -        } else if (is_snan(a_cls)) {
 -            return 0;
 -        } else if (is_snan(b_cls)) {
 -            return 1;
 -        } else if (is_qnan(c_cls)) {
 -            return 2;
 -        } else if (is_qnan(a_cls)) {
 -            return 0;
 -        } else {
 -            return 1;
 -        }
 -    }
  #elif defined(TARGET_LOONGARCH64)
 -    /* Prefer sNaN over qNaN, in the c, a, b order. */
 -    if (is_snan(c_cls)) {
 -        return 2;
 -    } else if (is_snan(a_cls)) {
 -        return 0;
 -    } else if (is_snan(b_cls)) {
 -        return 1;
 -    } else if (is_qnan(c_cls)) {
 -        return 2;
 -    } else if (is_qnan(a_cls)) {
 -        return 0;
 -    } else {
 -        return 1;
 -    }
 +        rule = float_3nan_prop_s_cab;
  #elif defined(TARGET_PPC)
 -    /* If fRA is a NaN return it; otherwise if fRB is a NaN return it;
 -     * otherwise return fRC. Note that muladd on PPC is (fRA * fRC) + frB
 -     */
 -    if (is_nan(a_cls)) {
 -        return 0;
 -    } else if (is_nan(c_cls)) {
 -        return 2;
 -    } else {
 -        return 1;
 -    }
 +        /*
 +         * If fRA is a NaN return it; otherwise if fRB is a NaN return it;
 +         * otherwise return fRC. Note that muladd on PPC is (fRA * fRC) + frB
 +         */
 +        rule = float_3nan_prop_acb;
  #elif defined(TARGET_S390X)
 -    if (is_snan(a_cls)) {
 -        return 0;
 -    } else if (is_snan(b_cls)) {
 -        return 1;
 -    } else if (is_snan(c_cls)) {
 -        return 2;
 -    } else if (is_qnan(a_cls)) {
 -        return 0;
 -    } else if (is_qnan(b_cls)) {
 -        return 1;
 -    } else {
 -        return 2;
 -    }
 +        rule = float_3nan_prop_s_abc;
  #elif defined(TARGET_SPARC)
 -    /* Prefer SNaN over QNaN, order C, B, A. */
 -    if (is_snan(c_cls)) {
 -        return 2;
 -    } else if (is_snan(b_cls)) {
 -        return 1;
 -    } else if (is_snan(a_cls)) {
 -        return 0;
 -    } else if (is_qnan(c_cls)) {
 -        return 2;
 -    } else if (is_qnan(b_cls)) {
 -        return 1;
 -    } else {
 -        return 0;
 -    }
 +        rule = float_3nan_prop_s_cba;
  #elif defined(TARGET_XTENSA)
 -    /*
 -     * For Xtensa, the (inf,zero,nan) case sets InvalidOp and returns
 -     * an input NaN if we have one (ie c).
 -     */
 -    if (status->use_first_nan) {
 -        if (is_nan(a_cls)) {
 -            return 0;
 -        } else if (is_nan(b_cls)) {
 -            return 1;
 +        if (status->use_first_nan) {
 +            rule = float_3nan_prop_abc;
          } else {
 -            return 2;
 +            rule = float_3nan_prop_cba;
          }
 -    } else {
 -        if (is_nan(c_cls)) {
 -            return 2;
 -        } else if (is_nan(b_cls)) {
 -            return 1;
 -        } else {
 -            return 0;
 -        }
 -    }
  #else
 -    /* A default implementation: prefer a to b to c.
 -     * This is unlikely to actually match any real implementation.
 -     */
 -    if (is_nan(a_cls)) {
 -        return 0;
 -    } else if (is_nan(b_cls)) {
 -        return 1;
 -    } else {
 -        return 2;
 -    }
 +        rule = float_3nan_prop_abc;
  #endif
 +    }
 +
-     return rebuild_hflags_common(env, fp_el, mmu_idx, flags);
++    assert(rule != float_3nan_prop_none);
 +    if (have_snan && (rule & R_3NAN_SNAN_MASK)) {
 +        /* We have at least one SNaN input and should prefer it */
 +        do {
 +            which = rule & R_3NAN_1ST_MASK;
 +            rule >>= R_3NAN_1ST_LENGTH;
 +        } while (!is_snan(cls[which]));
 +    } else {
 +        do {
 +            which = rule & R_3NAN_1ST_MASK;
 +            rule >>= R_3NAN_1ST_LENGTH;
 +        } while (!is_nan(cls[which]));
 +    }
 +    return which;
  }
-diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
+ /*----------------------------------------------------------------------------
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_init_disas_context(DisasContextBase *dcbase,
      dc->mmu_idx = core_to_aa64_mmu_idx(core_mmu_idx);
      dc->tbii = FIELD_EX32(tb_flags, TBFLAG_A64, TBII);
      dc->tbid = FIELD_EX32(tb_flags, TBFLAG_A64, TBID);
 +    dc->tcma = FIELD_EX32(tb_flags, TBFLAG_A64, TCMA);
      dc->current_el = arm_mmu_idx_to_el(dc->mmu_idx);
  #if !defined(CONFIG_USER_ONLY)
      dc->user = (dc->current_el == 0);
@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_init_disas_context(DisasContextBase *dcbase,
      dc->bt = FIELD_EX32(tb_flags, TBFLAG_A64, BT);
      dc->btype = FIELD_EX32(tb_flags, TBFLAG_A64, BTYPE);
      dc->unpriv = FIELD_EX32(tb_flags, TBFLAG_A64, UNPRIV);
 +    dc->ata = FIELD_EX32(tb_flags, TBFLAG_A64, ATA);
 +    dc->mte_active[0] = FIELD_EX32(tb_flags, TBFLAG_A64, MTE_ACTIVE);
 +    dc->mte_active[1] = FIELD_EX32(tb_flags, TBFLAG_A64, MTE0_ACTIVE);
      dc->vec_len = 0;
      dc->vec_stride = 0;
      dc->cp_regs = arm_cpu->cp_regs;
 --
-.20.1
+.34.1

-New patch
+[PULL 21/72] tests/fp: Explicitly set 3-NaN propagation rule
+Explicitly set a rule in the softfloat tests for propagating NaNs in
+the muladd case.  In meson.build we put -DTARGET_ARM in fpcflags, and
+so we should select here the Arm rule of float_3nan_prop_s_cab.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-17-peter.maydell@linaro.org
+---
+ tests/fp/fp-bench.c | 1 +
+ tests/fp/fp-test.c  | 1 +
+files changed, 2 insertions(+)
+diff --git a/tests/fp/fp-bench.c b/tests/fp/fp-bench.c
+index XXXXXXX..XXXXXXX 100644
+--- a/tests/fp/fp-bench.c
++++ b/tests/fp/fp-bench.c
+@@ -XXX,XX +XXX,XX @@ static void run_bench(void)
+      * doesn't specify match those used by the Arm architecture.
+      */
+     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &soft_status);
++    set_float_3nan_prop_rule(float_3nan_prop_s_cab, &soft_status);
+     set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, &soft_status);
+     f = bench_funcs[operation][precision];
+diff --git a/tests/fp/fp-test.c b/tests/fp/fp-test.c
+index XXXXXXX..XXXXXXX 100644
+--- a/tests/fp/fp-test.c
++++ b/tests/fp/fp-test.c
+@@ -XXX,XX +XXX,XX @@ void run_test(void)
+      * doesn't specify match those used by the Arm architecture.
+      */
+     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &qsf);
++    set_float_3nan_prop_rule(float_3nan_prop_s_cab, &qsf);
+     set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, &qsf);
+     genCases_setLevel(test_level);
+--
+.34.1

-[PULL 26/57] target/arm: Define arm_cpu_do_unaligned_access for user-only
+[PULL 22/72] target/arm: Set Float3NaNPropRule explicitly
-From: Richard Henderson <richard.henderson@linaro.org>
+Set the Float3NaNPropRule explicitly for Arm, and remove the
 ifdef from pickNaNMulAdd().
-Use the same code as system mode, so that we generate the same
-exception + syndrome for the unaligned access.
-For the moment, if MTE is enabled so that this path is reachable,
-this would generate a SIGSEGV in the user-only cpu_loop.  Decoding
-the syndrome to produce the proper SIGBUS will be done later.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20200626033144.790098-15-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-18-peter.maydell@linaro.org
 ---
- target/arm/cpu.c        | 2 +-
+ target/arm/cpu.c               | 5 +++++
- target/arm/tlb_helper.c | 4 ++--
+ fpu/softfloat-specialize.c.inc | 8 +-------
-files changed, 3 insertions(+), 3 deletions(-)
+files changed, 6 insertions(+), 7 deletions(-)
 diff --git a/target/arm/cpu.c b/target/arm/cpu.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu.c
 +++ b/target/arm/cpu.c
-@@ -XXX,XX +XXX,XX @@ static void arm_cpu_class_init(ObjectClass *oc, void *data)
+@@ -XXX,XX +XXX,XX @@ void arm_register_el_change_hook(ARMCPU *cpu, ARMELChangeHookFn *hook,
-     cc->tlb_fill = arm_cpu_tlb_fill;
+  *  * tininess-before-rounding
-     cc->debug_excp_handler = arm_debug_excp_handler;
+  *  * 2-input NaN propagation prefers SNaN over QNaN, and then
-     cc->debug_check_watchpoint = arm_debug_check_watchpoint;
+  *    operand A over operand B (see FPProcessNaNs() pseudocode)
--#if !defined(CONFIG_USER_ONLY)
++ *  * 3-input NaN propagation prefers SNaN over QNaN, and then
-     cc->do_unaligned_access = arm_cpu_do_unaligned_access;
++ *    operand C over A over B (see FPProcessNaNs3() pseudocode,
-+#if !defined(CONFIG_USER_ONLY)
++ *    but note that for QEMU muladd is a * b + c, whereas for
-     cc->do_transaction_failed = arm_cpu_do_transaction_failed;
++ *    the pseudocode function the arguments are in the order c, a, b.
-     cc->adjust_watchpoint_address = arm_adjust_watchpoint_address;
+  *  * 0 * Inf + NaN returns the default NaN if the input NaN is quiet,
- #endif /* CONFIG_TCG && !CONFIG_USER_ONLY */
+  *    and the input NaN if it is signalling
-diff --git a/target/arm/tlb_helper.c b/target/arm/tlb_helper.c
+  */
@@ -XXX,XX +XXX,XX @@ static void arm_set_default_fp_behaviours(float_status *s)
  {
      set_float_detect_tininess(float_tininess_before_rounding, s);
      set_float_2nan_prop_rule(float_2nan_prop_s_ab, s);
 +    set_float_3nan_prop_rule(float_3nan_prop_s_cab, s);
      set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, s);
  }
 diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/tlb_helper.c
+--- a/fpu/softfloat-specialize.c.inc
-+++ b/target/arm/tlb_helper.c
++++ b/fpu/softfloat-specialize.c.inc
-@@ -XXX,XX +XXX,XX @@
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
- #include "internals.h"
+     }
- #include "exec/exec-all.h"
+     if (rule == float_3nan_prop_none) {
--#if !defined(CONFIG_USER_ONLY)
+-#if defined(TARGET_ARM)
--
+-        /*
- static inline uint32_t merge_syn_data_abort(uint32_t template_syn,
+-         * This looks different from the ARM ARM pseudocode, because the ARM ARM
-                                             unsigned int target_el,
+-         * puts the operands to a fused mac operation (a*b)+c in the order c,a,b
-                                             bool same_el, bool ea,
+-         */
-@@ -XXX,XX +XXX,XX @@ void arm_cpu_do_unaligned_access(CPUState *cs, vaddr vaddr,
+-        rule = float_3nan_prop_s_cab;
-     arm_deliver_fault(cpu, vaddr, access_type, mmu_idx, &fi);
+-#elif defined(TARGET_MIPS)
- }
++#if defined(TARGET_MIPS)
+         if (snan_bit_is_one(status)) {
-+#if !defined(CONFIG_USER_ONLY)
+             rule = float_3nan_prop_s_abc;
-+
+         } else {
  /*
   * arm_cpu_do_transaction_failed: handle a memory system error response
   * (eg "no device/memory present at address") by raising an external abort
 --
-.20.1
+.34.1

-[PULL 37/57] target/arm: Implement helper_mte_check1
+[PULL 23/72] target/loongarch: Set Float3NaNPropRule explicitly
-From: Richard Henderson <richard.henderson@linaro.org>
+Set the Float3NaNPropRule explicitly for loongarch, and remove the
 ifdef from pickNaNMulAdd().
-Fill out the stub that was added earlier.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20241202131347.498124-19-peter.maydell@linaro.org
 ---
  target/loongarch/tcg/fpu_helper.c | 1 +
  fpu/softfloat-specialize.c.inc    | 2 --
 files changed, 1 insertion(+), 2 deletions(-)
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+diff --git a/target/loongarch/tcg/fpu_helper.c b/target/loongarch/tcg/fpu_helper.c
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20200626033144.790098-26-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/internals.h  |  48 +++++++++++++++
  target/arm/mte_helper.c | 132 +++++++++++++++++++++++++++++++++++++++-
 files changed, 179 insertions(+), 1 deletion(-)
 diff --git a/target/arm/internals.h b/target/arm/internals.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/internals.h
+--- a/target/loongarch/tcg/fpu_helper.c
-+++ b/target/arm/internals.h
++++ b/target/loongarch/tcg/fpu_helper.c
-@@ -XXX,XX +XXX,XX @@ FIELD(MTEDESC, WRITE, 8, 1)
+@@ -XXX,XX +XXX,XX @@ void restore_fp_status(CPULoongArchState *env)
- FIELD(MTEDESC, ESIZE, 9, 5)
+      * case sets InvalidOp and returns the input value 'c'
- FIELD(MTEDESC, TSIZE, 14, 10)  /* mte_checkN only */
+      */
+     set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
-+bool mte_probe1(CPUARMState *env, uint32_t desc, uint64_t ptr);
++    set_float_3nan_prop_rule(float_3nan_prop_s_cab, &env->fp_status);
 +uint64_t mte_check1(CPUARMState *env, uint32_t desc,
 +                    uint64_t ptr, uintptr_t ra);
 +
  static inline int allocation_tag_from_addr(uint64_t ptr)
  {
      return extract64(ptr, 56, 4);
@@ -XXX,XX +XXX,XX @@ static inline uint64_t address_with_allocation_tag(uint64_t ptr, int rtag)
      return deposit64(ptr, 56, 4, rtag);
  }
-+/* Return true if tbi bits mean that the access is checked.  */
+ int ieee_ex_to_loongarch(int xcpt)
-+static inline bool tbi_check(uint32_t desc, int bit55)
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 +{
 +    return (desc >> (R_MTEDESC_TBI_SHIFT + bit55)) & 1;
 +}
 +
 +/* Return true if tcma bits mean that the access is unchecked.  */
 +static inline bool tcma_check(uint32_t desc, int bit55, int ptr_tag)
 +{
 +    /*
 +     * We had extracted bit55 and ptr_tag for other reasons, so fold
 +     * (ptr<59:55> == 00000 || ptr<59:55> == 11111) into a single test.
 +     */
 +    bool match = ((ptr_tag + bit55) & 0xf) == 0;
 +    bool tcma = (desc >> (R_MTEDESC_TCMA_SHIFT + bit55)) & 1;
 +    return tcma && match;
 +}
 +
 +/*
 + * For TBI, ideally, we would do nothing.  Proper behaviour on fault is
 + * for the tag to be present in the FAR_ELx register.  But for user-only
 + * mode, we do not have a TLB with which to implement this, so we must
 + * remove the top byte.
 + */
 +static inline uint64_t useronly_clean_ptr(uint64_t ptr)
 +{
 +    /* TBI is known to be enabled. */
 +#ifdef CONFIG_USER_ONLY
 +    ptr = sextract64(ptr, 0, 56);
 +#endif
 +    return ptr;
 +}
 +
 +static inline uint64_t useronly_maybe_clean_ptr(uint32_t desc, uint64_t ptr)
 +{
 +#ifdef CONFIG_USER_ONLY
 +    int64_t clean_ptr = sextract64(ptr, 0, 56);
 +    if (tbi_check(desc, clean_ptr < 0)) {
 +        ptr = clean_ptr;
 +    }
 +#endif
 +    return ptr;
 +}
 +
  #endif
 diff --git a/target/arm/mte_helper.c b/target/arm/mte_helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/mte_helper.c
+--- a/fpu/softfloat-specialize.c.inc
-+++ b/target/arm/mte_helper.c
++++ b/fpu/softfloat-specialize.c.inc
-@@ -XXX,XX +XXX,XX @@ void HELPER(stzgm_tags)(CPUARMState *env, uint64_t ptr, uint64_t val)
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
-     }
+         } else {
- }
+             rule = float_3nan_prop_s_cab;
+         }
-+/* Record a tag check failure.  */
+-#elif defined(TARGET_LOONGARCH64)
-+static void mte_check_fail(CPUARMState *env, int mmu_idx,
+-        rule = float_3nan_prop_s_cab;
-+                           uint64_t dirty_ptr, uintptr_t ra)
+ #elif defined(TARGET_PPC)
-+{
+         /*
-+    ARMMMUIdx arm_mmu_idx = core_to_aa64_mmu_idx(mmu_idx);
+          * If fRA is a NaN return it; otherwise if fRB is a NaN return it;
 +    int el, reg_el, tcf, select;
 +    uint64_t sctlr;
 +
 +    reg_el = regime_el(env, arm_mmu_idx);
 +    sctlr = env->cp15.sctlr_el[reg_el];
 +
 +    switch (arm_mmu_idx) {
 +    case ARMMMUIdx_E10_0:
 +    case ARMMMUIdx_E20_0:
 +        el = 0;
 +        tcf = extract64(sctlr, 38, 2);
 +        break;
 +    default:
 +        el = reg_el;
 +        tcf = extract64(sctlr, 40, 2);
 +    }
 +
 +    switch (tcf) {
 +    case 1:
 +        /*
 +         * Tag check fail causes a synchronous exception.
 +         *
 +         * In restore_state_to_opc, we set the exception syndrome
 +         * for the load or store operation.  Unwind first so we
 +         * may overwrite that with the syndrome for the tag check.
 +         */
 +        cpu_restore_state(env_cpu(env), ra, true);
 +        env->exception.vaddress = dirty_ptr;
 +        raise_exception(env, EXCP_DATA_ABORT,
 +                        syn_data_abort_no_iss(el != 0, 0, 0, 0, 0, 0, 0x11),
 +                        exception_target_el(env));
 +        /* noreturn, but fall through to the assert anyway */
 +
 +    case 0:
 +        /*
 +         * Tag check fail does not affect the PE.
 +         * We eliminate this case by not setting MTE_ACTIVE
 +         * in tb_flags, so that we never make this runtime call.
 +         */
 +        g_assert_not_reached();
 +
 +    case 2:
 +        /* Tag check fail causes asynchronous flag set.  */
 +        mmu_idx = arm_mmu_idx_el(env, el);
 +        if (regime_has_2_ranges(mmu_idx)) {
 +            select = extract64(dirty_ptr, 55, 1);
 +        } else {
 +            select = 0;
 +        }
 +        env->cp15.tfsr_el[el] |= 1 << select;
 +        break;
 +
 +    default:
 +        /* Case 3: Reserved. */
 +        qemu_log_mask(LOG_GUEST_ERROR,
 +                      "Tag check failure with SCTLR_EL%d.TCF%s "
 +                      "set to reserved value %d\n",
 +                      reg_el, el ? "" : "0", tcf);
 +        break;
 +    }
 +}
 +
  /*
   * Perform an MTE checked access for a single logical or atomic access.
   */
 +static bool mte_probe1_int(CPUARMState *env, uint32_t desc, uint64_t ptr,
 +                           uintptr_t ra, int bit55)
 +{
 +    int mem_tag, mmu_idx, ptr_tag, size;
 +    MMUAccessType type;
 +    uint8_t *mem;
 +
 +    ptr_tag = allocation_tag_from_addr(ptr);
 +
 +    if (tcma_check(desc, bit55, ptr_tag)) {
 +        return true;
 +    }
 +
 +    mmu_idx = FIELD_EX32(desc, MTEDESC, MIDX);
 +    type = FIELD_EX32(desc, MTEDESC, WRITE) ? MMU_DATA_STORE : MMU_DATA_LOAD;
 +    size = FIELD_EX32(desc, MTEDESC, ESIZE);
 +
 +    mem = allocation_tag_mem(env, mmu_idx, ptr, type, size,
 +                             MMU_DATA_LOAD, 1, ra);
 +    if (!mem) {
 +        return true;
 +    }
 +
 +    mem_tag = load_tag1(ptr, mem);
 +    return ptr_tag == mem_tag;
 +}
 +
 +/*
 + * No-fault version of mte_check1, to be used by SVE for MemSingleNF.
 + * Returns false if the access is Checked and the check failed.  This
 + * is only intended to probe the tag -- the validity of the page must
 + * be checked beforehand.
 + */
 +bool mte_probe1(CPUARMState *env, uint32_t desc, uint64_t ptr)
 +{
 +    int bit55 = extract64(ptr, 55, 1);
 +
 +    /* If TBI is disabled, the access is unchecked. */
 +    if (unlikely(!tbi_check(desc, bit55))) {
 +        return true;
 +    }
 +
 +    return mte_probe1_int(env, desc, ptr, 0, bit55);
 +}
 +
 +uint64_t mte_check1(CPUARMState *env, uint32_t desc,
 +                    uint64_t ptr, uintptr_t ra)
 +{
 +    int bit55 = extract64(ptr, 55, 1);
 +
 +    /* If TBI is disabled, the access is unchecked, and ptr is not dirty. */
 +    if (unlikely(!tbi_check(desc, bit55))) {
 +        return ptr;
 +    }
 +
 +    if (unlikely(!mte_probe1_int(env, desc, ptr, ra, bit55))) {
 +        int mmu_idx = FIELD_EX32(desc, MTEDESC, MIDX);
 +        mte_check_fail(env, mmu_idx, ptr, ra);
 +    }
 +
 +    return useronly_clean_ptr(ptr);
 +}
 +
  uint64_t HELPER(mte_check1)(CPUARMState *env, uint32_t desc, uint64_t ptr)
  {
 -    return ptr;
 +    return mte_check1(env, desc, ptr, GETPC());
  }
  /*
 --
-.20.1
+.34.1

-New patch
+[PULL 24/72] target/ppc: Set Float3NaNPropRule explicitly
+Set the Float3NaNPropRule explicitly for PPC, and remove the
+ifdef from pickNaNMulAdd().
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-20-peter.maydell@linaro.org
+---
+ target/ppc/cpu_init.c          | 8 ++++++++
+ fpu/softfloat-specialize.c.inc | 6 ------
+files changed, 8 insertions(+), 6 deletions(-)
+diff --git a/target/ppc/cpu_init.c b/target/ppc/cpu_init.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/ppc/cpu_init.c
++++ b/target/ppc/cpu_init.c
+@@ -XXX,XX +XXX,XX @@ static void ppc_cpu_reset_hold(Object *obj, ResetType type)
+      */
+     set_float_2nan_prop_rule(float_2nan_prop_ab, &env->fp_status);
+     set_float_2nan_prop_rule(float_2nan_prop_ab, &env->vec_status);
++    /*
++     * NaN propagation for fused multiply-add:
++     * if fRA is a NaN return it; otherwise if fRB is a NaN return it;
++     * otherwise return fRC. Note that muladd on PPC is (fRA * fRC) + frB
++     * whereas QEMU labels the operands as (a * b) + c.
++     */
++    set_float_3nan_prop_rule(float_3nan_prop_acb, &env->fp_status);
++    set_float_3nan_prop_rule(float_3nan_prop_acb, &env->vec_status);
+     /*
+      * For PPC, the (inf,zero,qnan) case sets InvalidOp, but we prefer
+      * to return an input NaN if we have one (ie c) rather than generating
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
+index XXXXXXX..XXXXXXX 100644
+--- a/fpu/softfloat-specialize.c.inc
++++ b/fpu/softfloat-specialize.c.inc
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
+         } else {
+             rule = float_3nan_prop_s_cab;
+         }
+-#elif defined(TARGET_PPC)
+-        /*
+-         * If fRA is a NaN return it; otherwise if fRB is a NaN return it;
+-         * otherwise return fRC. Note that muladd on PPC is (fRA * fRC) + frB
+-         */
+-        rule = float_3nan_prop_acb;
+ #elif defined(TARGET_S390X)
+         rule = float_3nan_prop_s_abc;
+ #elif defined(TARGET_SPARC)
+--
+.34.1

-New patch
+[PULL 25/72] target/s390x: Set Float3NaNPropRule explicitly
+Set the Float3NaNPropRule explicitly for s390x, and remove the
+ifdef from pickNaNMulAdd().
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-21-peter.maydell@linaro.org
+---
+ target/s390x/cpu.c             | 1 +
+ fpu/softfloat-specialize.c.inc | 2 --
+files changed, 1 insertion(+), 2 deletions(-)
+diff --git a/target/s390x/cpu.c b/target/s390x/cpu.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/s390x/cpu.c
++++ b/target/s390x/cpu.c
+@@ -XXX,XX +XXX,XX @@ static void s390_cpu_reset_hold(Object *obj, ResetType type)
+         set_float_detect_tininess(float_tininess_before_rounding,
+                                   &env->fpu_status);
+         set_float_2nan_prop_rule(float_2nan_prop_s_ab, &env->fpu_status);
++        set_float_3nan_prop_rule(float_3nan_prop_s_abc, &env->fpu_status);
+         set_float_infzeronan_rule(float_infzeronan_dnan_always,
+                                   &env->fpu_status);
+        /* fall through */
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
+index XXXXXXX..XXXXXXX 100644
+--- a/fpu/softfloat-specialize.c.inc
++++ b/fpu/softfloat-specialize.c.inc
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
+         } else {
+             rule = float_3nan_prop_s_cab;
+         }
+-#elif defined(TARGET_S390X)
+-        rule = float_3nan_prop_s_abc;
+ #elif defined(TARGET_SPARC)
+         rule = float_3nan_prop_s_cba;
+ #elif defined(TARGET_XTENSA)
+--
+.34.1

-New patch
+[PULL 26/72] target/sparc: Set Float3NaNPropRule explicitly
+Set the Float3NaNPropRule explicitly for SPARC, and remove the
+ifdef from pickNaNMulAdd().
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-22-peter.maydell@linaro.org
+---
+ target/sparc/cpu.c             | 2 ++
+ fpu/softfloat-specialize.c.inc | 2 --
+files changed, 2 insertions(+), 2 deletions(-)
+diff --git a/target/sparc/cpu.c b/target/sparc/cpu.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/sparc/cpu.c
++++ b/target/sparc/cpu.c
+@@ -XXX,XX +XXX,XX @@ static void sparc_cpu_realizefn(DeviceState *dev, Error **errp)
+      * the CPU state struct so it won't get zeroed on reset.
+      */
+     set_float_2nan_prop_rule(float_2nan_prop_s_ba, &env->fp_status);
++    /* For fused-multiply add, prefer SNaN over QNaN, then C->B->A */
++    set_float_3nan_prop_rule(float_3nan_prop_s_cba, &env->fp_status);
+     /* For inf * 0 + NaN, return the input NaN */
+     set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
+index XXXXXXX..XXXXXXX 100644
+--- a/fpu/softfloat-specialize.c.inc
++++ b/fpu/softfloat-specialize.c.inc
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
+         } else {
+             rule = float_3nan_prop_s_cab;
+         }
+-#elif defined(TARGET_SPARC)
+-        rule = float_3nan_prop_s_cba;
+ #elif defined(TARGET_XTENSA)
+         if (status->use_first_nan) {
+             rule = float_3nan_prop_abc;
+--
+.34.1

-[PULL 22/57] target/arm: Revise decoding for disas_add_sub_imm
+[PULL 27/72] target/mips: Set Float3NaNPropRule explicitly
-From: Richard Henderson <richard.henderson@linaro.org>
+Set the Float3NaNPropRule explicitly for Arm, and remove the
 ifdef from pickNaNMulAdd().
-The current Arm ARM has adjusted the official decode of
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-"Add/subtract (immediate)" so that the shift field is only bit 22,
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-and bit 23 is part of the op1 field of the parent category
+Message-id: 20241202131347.498124-23-peter.maydell@linaro.org
-"Data processing - immediate".
+---
  target/mips/fpu_helper.h       | 4 ++++
  target/mips/msa.c              | 3 +++
  fpu/softfloat-specialize.c.inc | 8 +-------
 files changed, 8 insertions(+), 7 deletions(-)
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+diff --git a/target/mips/fpu_helper.h b/target/mips/fpu_helper.h
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20200626033144.790098-11-richard.henderson@linaro.org
 Suggested-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/translate-a64.c | 23 ++++++++---------------
 file changed, 8 insertions(+), 15 deletions(-)
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-a64.c
+--- a/target/mips/fpu_helper.h
-+++ b/target/arm/translate-a64.c
++++ b/target/mips/fpu_helper.h
-@@ -XXX,XX +XXX,XX @@ static void disas_pc_rel_adr(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static inline void restore_snan_bit_mode(CPUMIPSState *env)
  /*
   * Add/subtract (immediate)
   *
 - *  31 30 29 28       24 23 22 21         10 9   5 4   0
 - * +--+--+--+-----------+-----+-------------+-----+-----+
 - * |sf|op| S| 1 0 0 0 1 |shift|    imm12    |  Rn | Rd  |
 - * +--+--+--+-----------+-----+-------------+-----+-----+
 + *  31 30 29 28         23 22 21         10 9   5 4   0
 + * +--+--+--+-------------+--+-------------+-----+-----+
 + * |sf|op| S| 1 0 0 0 1 0 |sh|    imm12    |  Rn | Rd  |
 + * +--+--+--+-------------+--+-------------+-----+-----+
   *
   *    sf: 0 -> 32bit, 1 -> 64bit
   *    op: 0 -> add  , 1 -> sub
   *     S: 1 -> set flags
 - * shift: 00 -> LSL imm by 0, 01 -> LSL imm by 12
 + *    sh: 1 -> LSL imm by 12
   */
  static void disas_add_sub_imm(DisasContext *s, uint32_t insn)
  {
-     int rd = extract32(insn, 0, 5);
+     bool nan2008 = env->active_fpu.fcr31 & (1 << FCR31_NAN2008);
-     int rn = extract32(insn, 5, 5);
+     FloatInfZeroNaNRule izn_rule;
-     uint64_t imm = extract32(insn, 10, 12);
++    Float3NaNPropRule nan3_rule;
--    int shift = extract32(insn, 22, 2);
-+    bool shift = extract32(insn, 22, 1);
+     /*
-     bool setflags = extract32(insn, 29, 1);
+      * With nan2008, SNaNs are silenced in the usual way.
-     bool sub_op = extract32(insn, 30, 1);
+@@ -XXX,XX +XXX,XX @@ static inline void restore_snan_bit_mode(CPUMIPSState *env)
-     bool is_64bit = extract32(insn, 31, 1);
+      */
-@@ -XXX,XX +XXX,XX @@ static void disas_add_sub_imm(DisasContext *s, uint32_t insn)
+     izn_rule = nan2008 ? float_infzeronan_dnan_never : float_infzeronan_dnan_always;
-     TCGv_i64 tcg_rd = setflags ? cpu_reg(s, rd) : cpu_reg_sp(s, rd);
+     set_float_infzeronan_rule(izn_rule, &env->active_fpu.fp_status);
-     TCGv_i64 tcg_result;
++    nan3_rule = nan2008 ? float_3nan_prop_s_cab : float_3nan_prop_s_abc;
++    set_float_3nan_prop_rule(nan3_rule, &env->active_fpu.fp_status);
--    switch (shift) {
++
--    case 0x0:
+ }
--        break;
--    case 0x1:
+ static inline void restore_fp_status(CPUMIPSState *env)
-+    if (shift) {
+diff --git a/target/mips/msa.c b/target/mips/msa.c
-         imm <<= 12;
+index XXXXXXX..XXXXXXX 100644
--        break;
+--- a/target/mips/msa.c
--    default:
++++ b/target/mips/msa.c
--        unallocated_encoding(s);
+@@ -XXX,XX +XXX,XX @@ void msa_reset(CPUMIPSState *env)
--        return;
+     set_float_2nan_prop_rule(float_2nan_prop_s_ab,
                               &env->active_tc.msa_fp_status);
 +    set_float_3nan_prop_rule(float_3nan_prop_s_cab,
 +                             &env->active_tc.msa_fp_status);
 +
      /* clear float_status exception flags */
      set_float_exception_flags(0, &env->active_tc.msa_fp_status);
 diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 index XXXXXXX..XXXXXXX 100644
 --- a/fpu/softfloat-specialize.c.inc
 +++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
      }
-     tcg_result = tcg_temp_new_i64();
+     if (rule == float_3nan_prop_none) {
-@@ -XXX,XX +XXX,XX @@ static void disas_data_proc_imm(DisasContext *s, uint32_t insn)
+-#if defined(TARGET_MIPS)
-     case 0x20: case 0x21: /* PC-rel. addressing */
+-        if (snan_bit_is_one(status)) {
-         disas_pc_rel_adr(s, insn);
+-            rule = float_3nan_prop_s_abc;
-         break;
+-        } else {
--    case 0x22: case 0x23: /* Add/subtract (immediate) */
+-            rule = float_3nan_prop_s_cab;
-+    case 0x22: /* Add/subtract (immediate) */
+-        }
-         disas_add_sub_imm(s, insn);
+-#elif defined(TARGET_XTENSA)
-         break;
++#if defined(TARGET_XTENSA)
-     case 0x24: /* Logical (immediate) */
+         if (status->use_first_nan) {
              rule = float_3nan_prop_abc;
          } else {
 --
-.20.1
+.34.1

-[PULL 36/57] target/arm: Add gen_mte_checkN
+[PULL 28/72] target/xtensa: Set Float3NaNPropRule explicitly
-From: Richard Henderson <richard.henderson@linaro.org>
+Set the Float3NaNPropRule explicitly for xtensa, and remove the
 ifdef from pickNaNMulAdd().
-Replace existing uses of check_data_tbi in translate-a64.c that
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-perform multiple logical memory access.  Leave the helper blank
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-for now to reduce the patch size.
+Message-id: 20241202131347.498124-24-peter.maydell@linaro.org
 ---
  target/xtensa/fpu_helper.c     | 2 ++
  fpu/softfloat-specialize.c.inc | 8 --------
 files changed, 2 insertions(+), 8 deletions(-)
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+diff --git a/target/xtensa/fpu_helper.c b/target/xtensa/fpu_helper.c
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20200626033144.790098-25-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/helper-a64.h    |  1 +
  target/arm/translate-a64.h |  2 ++
  target/arm/mte_helper.c    |  8 +++++
  target/arm/translate-a64.c | 71 +++++++++++++++++++++++++++++---------
 files changed, 66 insertions(+), 16 deletions(-)
 diff --git a/target/arm/helper-a64.h b/target/arm/helper-a64.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-a64.h
+--- a/target/xtensa/fpu_helper.c
-+++ b/target/arm/helper-a64.h
++++ b/target/xtensa/fpu_helper.c
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_2(xpaci, TCG_CALL_NO_RWG_SE, i64, env, i64)
+@@ -XXX,XX +XXX,XX @@ void xtensa_use_first_nan(CPUXtensaState *env, bool use_first)
- DEF_HELPER_FLAGS_2(xpacd, TCG_CALL_NO_RWG_SE, i64, env, i64)
+     set_use_first_nan(use_first, &env->fp_status);
+     set_float_2nan_prop_rule(use_first ? float_2nan_prop_ab : float_2nan_prop_ba,
- DEF_HELPER_FLAGS_3(mte_check1, TCG_CALL_NO_WG, i64, env, i32, i64)
+                              &env->fp_status);
-+DEF_HELPER_FLAGS_3(mte_checkN, TCG_CALL_NO_WG, i64, env, i32, i64)
++    set_float_3nan_prop_rule(use_first ? float_3nan_prop_abc : float_3nan_prop_cba,
- DEF_HELPER_FLAGS_3(irg, TCG_CALL_NO_RWG, i64, env, i64, i64)
++                             &env->fp_status);
- DEF_HELPER_FLAGS_4(addsubg, TCG_CALL_NO_RWG_SE, i64, env, i64, s32, i32)
+ }
- DEF_HELPER_FLAGS_3(ldg, TCG_CALL_NO_WG, i64, env, i64, i64)
-diff --git a/target/arm/translate-a64.h b/target/arm/translate-a64.h
+ void HELPER(wur_fpu2k_fcr)(CPUXtensaState *env, uint32_t v)
 diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-a64.h
+--- a/fpu/softfloat-specialize.c.inc
-+++ b/target/arm/translate-a64.h
++++ b/fpu/softfloat-specialize.c.inc
-@@ -XXX,XX +XXX,XX @@ bool logic_imm_decode_wmask(uint64_t *result, unsigned int immn,
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
  bool sve_access_check(DisasContext *s);
  TCGv_i64 gen_mte_check1(DisasContext *s, TCGv_i64 addr, bool is_write,
                          bool tag_checked, int log2_size);
 +TCGv_i64 gen_mte_checkN(DisasContext *s, TCGv_i64 addr, bool is_write,
 +                        bool tag_checked, int count, int log2_esize);
  /* We should have at some point before trying to access an FP register
   * done the necessary access check, so assert that
 diff --git a/target/arm/mte_helper.c b/target/arm/mte_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/mte_helper.c
 +++ b/target/arm/mte_helper.c
@@ -XXX,XX +XXX,XX @@ uint64_t HELPER(mte_check1)(CPUARMState *env, uint32_t desc, uint64_t ptr)
  {
      return ptr;
  }
 +
 +/*
 + * Perform an MTE checked access for multiple logical accesses.
 + */
 +uint64_t HELPER(mte_checkN)(CPUARMState *env, uint32_t desc, uint64_t ptr)
 +{
 +    return ptr;
 +}
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ TCGv_i64 gen_mte_check1(DisasContext *s, TCGv_i64 addr, bool is_write,
                                   false, get_mem_index(s));
  }
 +/*
 + * For MTE, check multiple logical sequential accesses.
 + */
 +TCGv_i64 gen_mte_checkN(DisasContext *s, TCGv_i64 addr, bool is_write,
 +                        bool tag_checked, int log2_esize, int total_size)
 +{
 +    if (tag_checked && s->mte_active[0] && total_size != (1 << log2_esize)) {
 +        TCGv_i32 tcg_desc;
 +        TCGv_i64 ret;
 +        int desc = 0;
 +
 +        desc = FIELD_DP32(desc, MTEDESC, MIDX, get_mem_index(s));
 +        desc = FIELD_DP32(desc, MTEDESC, TBI, s->tbid);
 +        desc = FIELD_DP32(desc, MTEDESC, TCMA, s->tcma);
 +        desc = FIELD_DP32(desc, MTEDESC, WRITE, is_write);
 +        desc = FIELD_DP32(desc, MTEDESC, ESIZE, 1 << log2_esize);
 +        desc = FIELD_DP32(desc, MTEDESC, TSIZE, total_size);
 +        tcg_desc = tcg_const_i32(desc);
 +
 +        ret = new_tmp_a64(s);
 +        gen_helper_mte_checkN(ret, cpu_env, tcg_desc, addr);
 +        tcg_temp_free_i32(tcg_desc);
 +
 +        return ret;
 +    }
 +    return gen_mte_check1(s, addr, is_write, tag_checked, log2_esize);
 +}
 +
  typedef struct DisasCompare64 {
      TCGCond cond;
      TCGv_i64 value;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_pair(DisasContext *s, uint32_t insn)
          }
      }
--    clean_addr = clean_data_tbi(s, dirty_addr);
+     if (rule == float_3nan_prop_none) {
-+    clean_addr = gen_mte_checkN(s, dirty_addr, !is_load,
+-#if defined(TARGET_XTENSA)
-+                                (wback || rn != 31) && !set_tag,
+-        if (status->use_first_nan) {
-+                                size, 2 << size);
+-            rule = float_3nan_prop_abc;
-+
+-        } else {
-     if (is_vector) {
+-            rule = float_3nan_prop_cba;
-         if (is_load) {
+-        }
-             do_fp_ld(s, rt, clean_addr, size);
+-#else
-@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
+         rule = float_3nan_prop_abc;
-     TCGv_i64 clean_addr, tcg_rn, tcg_ebytes;
+-#endif
      MemOp endian = s->be_data;
 -    int ebytes;   /* bytes per element */
 +    int total;    /* total bytes */
      int elements; /* elements per vector */
      int rpt;    /* num iterations */
      int selem;  /* structure elements */
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
          endian = MO_LE;
      }
--    /* Consecutive little-endian elements from a single register
+     assert(rule != float_3nan_prop_none);
 +    total = rpt * selem * (is_q ? 16 : 8);
 +    tcg_rn = cpu_reg_sp(s, rn);
 +
 +    /*
 +     * Issue the MTE check vs the logical repeat count, before we
 +     * promote consecutive little-endian elements below.
 +     */
 +    clean_addr = gen_mte_checkN(s, tcg_rn, is_store, is_postidx || rn != 31,
 +                                size, total);
 +
 +    /*
 +     * Consecutive little-endian elements from a single register
       * can be promoted to a larger little-endian operation.
       */
      if (selem == 1 && endian == MO_LE) {
          size = 3;
      }
 -    ebytes = 1 << size;
 -    elements = (is_q ? 16 : 8) / ebytes;
 -
 -    tcg_rn = cpu_reg_sp(s, rn);
 -    clean_addr = clean_data_tbi(s, tcg_rn);
 -    tcg_ebytes = tcg_const_i64(ebytes);
 +    elements = (is_q ? 16 : 8) >> size;
 +    tcg_ebytes = tcg_const_i64(1 << size);
      for (r = 0; r < rpt; r++) {
          int e;
          for (e = 0; e < elements; e++) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_multiple_struct(DisasContext *s, uint32_t insn)
      if (is_postidx) {
          if (rm == 31) {
 -            tcg_gen_addi_i64(tcg_rn, tcg_rn, rpt * elements * selem * ebytes);
 +            tcg_gen_addi_i64(tcg_rn, tcg_rn, total);
          } else {
              tcg_gen_add_i64(tcg_rn, tcg_rn, cpu_reg(s, rm));
          }
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
      int selem = (extract32(opc, 0, 1) << 1 | R) + 1;
      bool replicate = false;
      int index = is_q << 3 | S << 2 | size;
 -    int ebytes, xs;
 +    int xs, total;
      TCGv_i64 clean_addr, tcg_rn, tcg_ebytes;
      if (extract32(insn, 31, 1)) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
          return;
      }
 -    ebytes = 1 << scale;
 -
      if (rn == 31) {
          gen_check_sp_alignment(s);
      }
 +    total = selem << scale;
      tcg_rn = cpu_reg_sp(s, rn);
 -    clean_addr = clean_data_tbi(s, tcg_rn);
 -    tcg_ebytes = tcg_const_i64(ebytes);
 +    clean_addr = gen_mte_checkN(s, tcg_rn, !is_load, is_postidx || rn != 31,
 +                                scale, total);
 +
 +    tcg_ebytes = tcg_const_i64(1 << scale);
      for (xs = 0; xs < selem; xs++) {
          if (replicate) {
              /* Load and replicate to all elements */
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
      if (is_postidx) {
          if (rm == 31) {
 -            tcg_gen_addi_i64(tcg_rn, tcg_rn, selem * ebytes);
 +            tcg_gen_addi_i64(tcg_rn, tcg_rn, total);
          } else {
              tcg_gen_add_i64(tcg_rn, tcg_rn, cpu_reg(s, rm));
          }
 --
-.20.1
+.34.1

-[PULL 45/57] target/arm: Add mte helpers for sve scalar + int loads
+[PULL 29/72] target/i386: Set Float3NaNPropRule explicitly
-From: Richard Henderson <richard.henderson@linaro.org>
+Set the Float3NaNPropRule explicitly for i386.  We had no
 i386-specific behaviour in the old ifdef ladder, so we were using the
 default "prefer a then b then c" fallback; this is actually the
 correct per-the-spec handling for i386.
-Because the elements are sequential, we can eliminate many tests all
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-at once when the tag hits TCMA, or if the page(s) are not Tagged.
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20241202131347.498124-25-peter.maydell@linaro.org
 ---
  target/i386/tcg/fpu_helper.c | 1 +
 file changed, 1 insertion(+)
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+diff --git a/target/i386/tcg/fpu_helper.c b/target/i386/tcg/fpu_helper.c
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20200626033144.790098-34-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/cpu.h           |   1 +
  target/arm/helper-sve.h    |  58 ++++++++++
  target/arm/internals.h     |   6 +
  target/arm/sve_helper.c    | 218 ++++++++++++++++++++++++++++++-------
  target/arm/translate-sve.c | 186 ++++++++++++++++++++++---------
 files changed, 378 insertions(+), 91 deletions(-)
 diff --git a/target/arm/cpu.h b/target/arm/cpu.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/target/i386/tcg/fpu_helper.c
-+++ b/target/arm/cpu.h
++++ b/target/i386/tcg/fpu_helper.c
-@@ -XXX,XX +XXX,XX @@ static inline MemTxAttrs *typecheck_memtxattrs(MemTxAttrs *x)
+@@ -XXX,XX +XXX,XX @@ void cpu_init_fp_statuses(CPUX86State *env)
-  * generic target bits directly.
+      * there are multiple input NaNs they are selected in the order a, b, c.
-  */
+      */
- #define arm_tlb_bti_gp(x) (typecheck_memtxattrs(x)->target_tlb_bit0)
+     set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->sse_status);
-+#define arm_tlb_mte_tagged(x) (typecheck_memtxattrs(x)->target_tlb_bit1)
++    set_float_3nan_prop_rule(float_3nan_prop_abc, &env->sse_status);
  /*
   * Naming convention for isar_feature functions:
 diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper-sve.h
 +++ b/target/arm/helper-sve.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_4(sve_ld1sds_le_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
  DEF_HELPER_FLAGS_4(sve_ld1sdu_be_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
  DEF_HELPER_FLAGS_4(sve_ld1sds_be_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld1bb_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld2bb_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld3bb_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld4bb_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ld1hh_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld2hh_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld3hh_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld4hh_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ld1hh_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld2hh_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld3hh_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld4hh_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ld1ss_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld2ss_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld3ss_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld4ss_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ld1ss_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld2ss_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld3ss_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld4ss_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ld1dd_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld2dd_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld3dd_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld4dd_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ld1dd_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld2dd_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld3dd_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld4dd_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ld1bhu_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld1bsu_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld1bdu_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld1bhs_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld1bss_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld1bds_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ld1hsu_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld1hdu_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld1hss_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld1hds_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ld1hsu_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld1hdu_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld1hss_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld1hds_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ld1sdu_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld1sds_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ld1sdu_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ld1sds_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
  DEF_HELPER_FLAGS_4(sve_ldff1bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
  DEF_HELPER_FLAGS_4(sve_ldff1bhu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
  DEF_HELPER_FLAGS_4(sve_ldff1bsu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 diff --git a/target/arm/internals.h b/target/arm/internals.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/internals.h
 +++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ void arm_log_exception(int idx);
  #define LOG2_TAG_GRANULE 4
  #define TAG_GRANULE      (1 << LOG2_TAG_GRANULE)
 +/*
 + * The SVE simd_data field, for memory ops, contains either
 + * rd (5 bits) or a shift count (2 bits).
 + */
 +#define SVE_MTEDESC_SHIFT 5
 +
  /* Bits within a descriptor passed to the helper_mte_check* functions. */
  FIELD(MTEDESC, MIDX,  0, 4)
  FIELD(MTEDESC, TBI,   4, 2)
 diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve_helper.c
 +++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ static void sve_cont_ldst_watchpoints(SVEContLdSt *info, CPUARMState *env,
  #endif
  }
-+typedef uint64_t mte_check_fn(CPUARMState *, uint32_t, uint64_t, uintptr_t);
+ static inline uint8_t save_exception_flags(CPUX86State *env)
 +
 +static inline QEMU_ALWAYS_INLINE
 +void sve_cont_ldst_mte_check_int(SVEContLdSt *info, CPUARMState *env,
 +                                 uint64_t *vg, target_ulong addr, int esize,
 +                                 int msize, uint32_t mtedesc, uintptr_t ra,
 +                                 mte_check_fn *check)
 +{
 +    intptr_t mem_off, reg_off, reg_last;
 +
 +    /* Process the page only if MemAttr == Tagged. */
 +    if (arm_tlb_mte_tagged(&info->page[0].attrs)) {
 +        mem_off = info->mem_off_first[0];
 +        reg_off = info->reg_off_first[0];
 +        reg_last = info->reg_off_split;
 +        if (reg_last < 0) {
 +            reg_last = info->reg_off_last[0];
 +        }
 +
 +        do {
 +            uint64_t pg = vg[reg_off >> 6];
 +            do {
 +                if ((pg >> (reg_off & 63)) & 1) {
 +                    check(env, mtedesc, addr, ra);
 +                }
 +                reg_off += esize;
 +                mem_off += msize;
 +            } while (reg_off <= reg_last && (reg_off & 63));
 +        } while (reg_off <= reg_last);
 +    }
 +
 +    mem_off = info->mem_off_first[1];
 +    if (mem_off >= 0 && arm_tlb_mte_tagged(&info->page[1].attrs)) {
 +        reg_off = info->reg_off_first[1];
 +        reg_last = info->reg_off_last[1];
 +
 +        do {
 +            uint64_t pg = vg[reg_off >> 6];
 +            do {
 +                if ((pg >> (reg_off & 63)) & 1) {
 +                    check(env, mtedesc, addr, ra);
 +                }
 +                reg_off += esize;
 +                mem_off += msize;
 +            } while (reg_off & 63);
 +        } while (reg_off <= reg_last);
 +    }
 +}
 +
 +typedef void sve_cont_ldst_mte_check_fn(SVEContLdSt *info, CPUARMState *env,
 +                                        uint64_t *vg, target_ulong addr,
 +                                        int esize, int msize, uint32_t mtedesc,
 +                                        uintptr_t ra);
 +
 +static void sve_cont_ldst_mte_check1(SVEContLdSt *info, CPUARMState *env,
 +                                     uint64_t *vg, target_ulong addr,
 +                                     int esize, int msize, uint32_t mtedesc,
 +                                     uintptr_t ra)
 +{
 +    sve_cont_ldst_mte_check_int(info, env, vg, addr, esize, msize,
 +                                mtedesc, ra, mte_check1);
 +}
 +
 +static void sve_cont_ldst_mte_checkN(SVEContLdSt *info, CPUARMState *env,
 +                                     uint64_t *vg, target_ulong addr,
 +                                     int esize, int msize, uint32_t mtedesc,
 +                                     uintptr_t ra)
 +{
 +    sve_cont_ldst_mte_check_int(info, env, vg, addr, esize, msize,
 +                                mtedesc, ra, mte_checkN);
 +}
 +
 +
  /*
   * Common helper for all contiguous 1,2,3,4-register predicated stores.
   */
  static inline QEMU_ALWAYS_INLINE
  void sve_ldN_r(CPUARMState *env, uint64_t *vg, const target_ulong addr,
                 uint32_t desc, const uintptr_t retaddr,
 -               const int esz, const int msz, const int N,
 +               const int esz, const int msz, const int N, uint32_t mtedesc,
                 sve_ldst1_host_fn *host_fn,
 -               sve_ldst1_tlb_fn *tlb_fn)
 +               sve_ldst1_tlb_fn *tlb_fn,
 +               sve_cont_ldst_mte_check_fn *mte_check_fn)
  {
      const unsigned rd = simd_data(desc);
      const intptr_t reg_max = simd_oprsz(desc);
@@ -XXX,XX +XXX,XX @@ void sve_ldN_r(CPUARMState *env, uint64_t *vg, const target_ulong addr,
      sve_cont_ldst_watchpoints(&info, env, vg, addr, 1 << esz, N << msz,
                                BP_MEM_READ, retaddr);
 -    /* TODO: MTE check. */
 +    /*
 +     * Handle mte checks for all active elements.
 +     * Since TBI must be set for MTE, !mtedesc => !mte_active.
 +     */
 +    if (mte_check_fn && mtedesc) {
 +        mte_check_fn(&info, env, vg, addr, 1 << esz, N << msz,
 +                     mtedesc, retaddr);
 +    }
      flags = info.page[0].flags | info.page[1].flags;
      if (unlikely(flags != 0)) {
@@ -XXX,XX +XXX,XX @@ void sve_ldN_r(CPUARMState *env, uint64_t *vg, const target_ulong addr,
      }
  }
 -#define DO_LD1_1(NAME, ESZ) \
 -void HELPER(sve_##NAME##_r)(CPUARMState *env, void *vg,        \
 -                            target_ulong addr, uint32_t desc)  \
 -{                                                              \
 -    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, MO_8, 1,      \
 -              sve_##NAME##_host, sve_##NAME##_tlb);            \
 +static inline QEMU_ALWAYS_INLINE
 +void sve_ldN_r_mte(CPUARMState *env, uint64_t *vg, target_ulong addr,
 +                   uint32_t desc, const uintptr_t ra,
 +                   const int esz, const int msz, const int N,
 +                   sve_ldst1_host_fn *host_fn,
 +                   sve_ldst1_tlb_fn *tlb_fn)
 +{
 +    uint32_t mtedesc = desc >> (SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
 +    int bit55 = extract64(addr, 55, 1);
 +
 +    /* Remove mtedesc from the normal sve descriptor. */
 +    desc = extract32(desc, 0, SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
 +
 +    /* Perform gross MTE suppression early. */
 +    if (!tbi_check(desc, bit55) ||
 +        tcma_check(desc, bit55, allocation_tag_from_addr(addr))) {
 +        mtedesc = 0;
 +    }
 +
 +    sve_ldN_r(env, vg, addr, desc, ra, esz, msz, N, mtedesc, host_fn, tlb_fn,
 +              N == 1 ? sve_cont_ldst_mte_check1 : sve_cont_ldst_mte_checkN);
  }
 -#define DO_LD1_2(NAME, ESZ, MSZ) \
 -void HELPER(sve_##NAME##_le_r)(CPUARMState *env, void *vg,        \
 -                               target_ulong addr, uint32_t desc)  \
 -{                                                                 \
 -    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, MSZ, 1,          \
 -              sve_##NAME##_le_host, sve_##NAME##_le_tlb);         \
 -}                                                                 \
 -void HELPER(sve_##NAME##_be_r)(CPUARMState *env, void *vg,        \
 -                               target_ulong addr, uint32_t desc)  \
 -{                                                                 \
 -    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, MSZ, 1,          \
 -              sve_##NAME##_be_host, sve_##NAME##_be_tlb);         \
 +#define DO_LD1_1(NAME, ESZ)                                             \
 +void HELPER(sve_##NAME##_r)(CPUARMState *env, void *vg,                 \
 +                            target_ulong addr, uint32_t desc)           \
 +{                                                                       \
 +    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, MO_8, 1, 0,            \
 +              sve_##NAME##_host, sve_##NAME##_tlb, NULL);               \
 +}                                                                       \
 +void HELPER(sve_##NAME##_r_mte)(CPUARMState *env, void *vg,             \
 +                                target_ulong addr, uint32_t desc)       \
 +{                                                                       \
 +    sve_ldN_r_mte(env, vg, addr, desc, GETPC(), ESZ, MO_8, 1,           \
 +                  sve_##NAME##_host, sve_##NAME##_tlb);                 \
 +}
 +
 +#define DO_LD1_2(NAME, ESZ, MSZ)                                        \
 +void HELPER(sve_##NAME##_le_r)(CPUARMState *env, void *vg,              \
 +                               target_ulong addr, uint32_t desc)        \
 +{                                                                       \
 +    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, MSZ, 1, 0,             \
 +              sve_##NAME##_le_host, sve_##NAME##_le_tlb, NULL);         \
 +}                                                                       \
 +void HELPER(sve_##NAME##_be_r)(CPUARMState *env, void *vg,              \
 +                               target_ulong addr, uint32_t desc)        \
 +{                                                                       \
 +    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, MSZ, 1, 0,             \
 +              sve_##NAME##_be_host, sve_##NAME##_be_tlb, NULL);         \
 +}                                                                       \
 +void HELPER(sve_##NAME##_le_r_mte)(CPUARMState *env, void *vg,          \
 +                                 target_ulong addr, uint32_t desc)      \
 +{                                                                       \
 +    sve_ldN_r_mte(env, vg, addr, desc, GETPC(), ESZ, MSZ, 1,            \
 +                  sve_##NAME##_le_host, sve_##NAME##_le_tlb);           \
 +}                                                                       \
 +void HELPER(sve_##NAME##_be_r_mte)(CPUARMState *env, void *vg,          \
 +                                 target_ulong addr, uint32_t desc)      \
 +{                                                                       \
 +    sve_ldN_r_mte(env, vg, addr, desc, GETPC(), ESZ, MSZ, 1,            \
 +                  sve_##NAME##_be_host, sve_##NAME##_be_tlb);           \
  }
  DO_LD1_1(ld1bb,  MO_8)
@@ -XXX,XX +XXX,XX @@ DO_LD1_2(ld1dd,  MO_64, MO_64)
  #undef DO_LD1_1
  #undef DO_LD1_2
 -#define DO_LDN_1(N) \
 -void HELPER(sve_ld##N##bb_r)(CPUARMState *env, void *vg,        \
 -                             target_ulong addr, uint32_t desc)  \
 -{                                                               \
 -    sve_ldN_r(env, vg, addr, desc, GETPC(), MO_8, MO_8, N,      \
 -              sve_ld1bb_host, sve_ld1bb_tlb);                   \
 +#define DO_LDN_1(N)                                                     \
 +void HELPER(sve_ld##N##bb_r)(CPUARMState *env, void *vg,                \
 +                             target_ulong addr, uint32_t desc)          \
 +{                                                                       \
 +    sve_ldN_r(env, vg, addr, desc, GETPC(), MO_8, MO_8, N, 0,           \
 +              sve_ld1bb_host, sve_ld1bb_tlb, NULL);                     \
 +}                                                                       \
 +void HELPER(sve_ld##N##bb_r_mte)(CPUARMState *env, void *vg,            \
 +                                 target_ulong addr, uint32_t desc)      \
 +{                                                                       \
 +    sve_ldN_r_mte(env, vg, addr, desc, GETPC(), MO_8, MO_8, N,          \
 +                  sve_ld1bb_host, sve_ld1bb_tlb);                       \
  }
 -#define DO_LDN_2(N, SUFF, ESZ) \
 -void HELPER(sve_ld##N##SUFF##_le_r)(CPUARMState *env, void *vg,       \
 -                                    target_ulong addr, uint32_t desc) \
 -{                                                                     \
 -    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, ESZ, N,              \
 -              sve_ld1##SUFF##_le_host, sve_ld1##SUFF##_le_tlb);       \
 -}                                                                     \
 -void HELPER(sve_ld##N##SUFF##_be_r)(CPUARMState *env, void *vg,       \
 -                                    target_ulong addr, uint32_t desc) \
 -{                                                                     \
 -    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, ESZ, N,              \
 -              sve_ld1##SUFF##_be_host, sve_ld1##SUFF##_be_tlb);       \
 +#define DO_LDN_2(N, SUFF, ESZ)                                          \
 +void HELPER(sve_ld##N##SUFF##_le_r)(CPUARMState *env, void *vg,         \
 +                                    target_ulong addr, uint32_t desc)   \
 +{                                                                       \
 +    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, ESZ, N, 0,             \
 +              sve_ld1##SUFF##_le_host, sve_ld1##SUFF##_le_tlb, NULL);   \
 +}                                                                       \
 +void HELPER(sve_ld##N##SUFF##_be_r)(CPUARMState *env, void *vg,         \
 +                                    target_ulong addr, uint32_t desc)   \
 +{                                                                       \
 +    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, ESZ, N, 0,             \
 +              sve_ld1##SUFF##_be_host, sve_ld1##SUFF##_be_tlb, NULL);   \
 +}                                                                       \
 +void HELPER(sve_ld##N##SUFF##_le_r_mte)(CPUARMState *env, void *vg,     \
 +                                        target_ulong addr, uint32_t desc) \
 +{                                                                       \
 +    sve_ldN_r_mte(env, vg, addr, desc, GETPC(), ESZ, ESZ, N,            \
 +                  sve_ld1##SUFF##_le_host, sve_ld1##SUFF##_le_tlb);     \
 +}                                                                       \
 +void HELPER(sve_ld##N##SUFF##_be_r_mte)(CPUARMState *env, void *vg,     \
 +                                        target_ulong addr, uint32_t desc) \
 +{                                                                       \
 +    sve_ldN_r_mte(env, vg, addr, desc, GETPC(), ESZ, ESZ, N,            \
 +                  sve_ld1##SUFF##_be_host, sve_ld1##SUFF##_be_tlb);     \
  }
  DO_LDN_1(2)
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-sve.c
 +++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static const uint8_t dtype_esz[16] = {
  };
  static void do_mem_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
 -                       int dtype, gen_helper_gvec_mem *fn)
 +                       int dtype, uint32_t mte_n, bool is_write,
 +                       gen_helper_gvec_mem *fn)
  {
      unsigned vsz = vec_full_reg_size(s);
      TCGv_ptr t_pg;
      TCGv_i32 t_desc;
 -    int desc;
 +    int desc = 0;
 -    /* For e.g. LD4, there are not enough arguments to pass all 4
 +    /*
 +     * For e.g. LD4, there are not enough arguments to pass all 4
       * registers as pointers, so encode the regno into the data field.
       * For consistency, do this even for LD1.
 +     * TODO: mte_n check here while callers are updated.
       */
 -    desc = simd_desc(vsz, vsz, zt);
 +    if (mte_n && s->mte_active[0]) {
 +        int msz = dtype_msz(dtype);
 +
 +        desc = FIELD_DP32(desc, MTEDESC, MIDX, get_mem_index(s));
 +        desc = FIELD_DP32(desc, MTEDESC, TBI, s->tbid);
 +        desc = FIELD_DP32(desc, MTEDESC, TCMA, s->tcma);
 +        desc = FIELD_DP32(desc, MTEDESC, WRITE, is_write);
 +        desc = FIELD_DP32(desc, MTEDESC, ESIZE, 1 << msz);
 +        desc = FIELD_DP32(desc, MTEDESC, TSIZE, mte_n << msz);
 +        desc <<= SVE_MTEDESC_SHIFT;
 +    }
 +    desc = simd_desc(vsz, vsz, zt | desc);
      t_desc = tcg_const_i32(desc);
      t_pg = tcg_temp_new_ptr();
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
  static void do_ld_zpa(DisasContext *s, int zt, int pg,
                        TCGv_i64 addr, int dtype, int nreg)
  {
 -    static gen_helper_gvec_mem * const fns[2][16][4] = {
 -        /* Little-endian */
 -        { { gen_helper_sve_ld1bb_r, gen_helper_sve_ld2bb_r,
 +    static gen_helper_gvec_mem * const fns[2][2][16][4] = {
 +        { /* mte inactive, little-endian */
 +          { { gen_helper_sve_ld1bb_r, gen_helper_sve_ld2bb_r,
              gen_helper_sve_ld3bb_r, gen_helper_sve_ld4bb_r },
 -          { gen_helper_sve_ld1bhu_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1bsu_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1bdu_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1bhu_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1bsu_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1bdu_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1sds_le_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1hh_le_r, gen_helper_sve_ld2hh_le_r,
 -            gen_helper_sve_ld3hh_le_r, gen_helper_sve_ld4hh_le_r },
 -          { gen_helper_sve_ld1hsu_le_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1hdu_le_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1sds_le_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1hh_le_r, gen_helper_sve_ld2hh_le_r,
 +              gen_helper_sve_ld3hh_le_r, gen_helper_sve_ld4hh_le_r },
 +            { gen_helper_sve_ld1hsu_le_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1hdu_le_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1hds_le_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1hss_le_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1ss_le_r, gen_helper_sve_ld2ss_le_r,
 -            gen_helper_sve_ld3ss_le_r, gen_helper_sve_ld4ss_le_r },
 -          { gen_helper_sve_ld1sdu_le_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1hds_le_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1hss_le_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1ss_le_r, gen_helper_sve_ld2ss_le_r,
 +              gen_helper_sve_ld3ss_le_r, gen_helper_sve_ld4ss_le_r },
 +            { gen_helper_sve_ld1sdu_le_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1bds_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1bss_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1bhs_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1dd_le_r, gen_helper_sve_ld2dd_le_r,
 -            gen_helper_sve_ld3dd_le_r, gen_helper_sve_ld4dd_le_r } },
 +            { gen_helper_sve_ld1bds_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1bss_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1bhs_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1dd_le_r, gen_helper_sve_ld2dd_le_r,
 +              gen_helper_sve_ld3dd_le_r, gen_helper_sve_ld4dd_le_r } },
 -        /* Big-endian */
 -        { { gen_helper_sve_ld1bb_r, gen_helper_sve_ld2bb_r,
 -            gen_helper_sve_ld3bb_r, gen_helper_sve_ld4bb_r },
 -          { gen_helper_sve_ld1bhu_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1bsu_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1bdu_r, NULL, NULL, NULL },
 +          /* mte inactive, big-endian */
 +          { { gen_helper_sve_ld1bb_r, gen_helper_sve_ld2bb_r,
 +              gen_helper_sve_ld3bb_r, gen_helper_sve_ld4bb_r },
 +            { gen_helper_sve_ld1bhu_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1bsu_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1bdu_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1sds_be_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1hh_be_r, gen_helper_sve_ld2hh_be_r,
 -            gen_helper_sve_ld3hh_be_r, gen_helper_sve_ld4hh_be_r },
 -          { gen_helper_sve_ld1hsu_be_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1hdu_be_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1sds_be_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1hh_be_r, gen_helper_sve_ld2hh_be_r,
 +              gen_helper_sve_ld3hh_be_r, gen_helper_sve_ld4hh_be_r },
 +            { gen_helper_sve_ld1hsu_be_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1hdu_be_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1hds_be_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1hss_be_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1ss_be_r, gen_helper_sve_ld2ss_be_r,
 -            gen_helper_sve_ld3ss_be_r, gen_helper_sve_ld4ss_be_r },
 -          { gen_helper_sve_ld1sdu_be_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1hds_be_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1hss_be_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1ss_be_r, gen_helper_sve_ld2ss_be_r,
 +              gen_helper_sve_ld3ss_be_r, gen_helper_sve_ld4ss_be_r },
 +            { gen_helper_sve_ld1sdu_be_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1bds_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1bss_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1bhs_r, NULL, NULL, NULL },
 -          { gen_helper_sve_ld1dd_be_r, gen_helper_sve_ld2dd_be_r,
 -            gen_helper_sve_ld3dd_be_r, gen_helper_sve_ld4dd_be_r } }
 +            { gen_helper_sve_ld1bds_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1bss_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1bhs_r, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1dd_be_r, gen_helper_sve_ld2dd_be_r,
 +              gen_helper_sve_ld3dd_be_r, gen_helper_sve_ld4dd_be_r } } },
 +
 +        { /* mte active, little-endian */
 +          { { gen_helper_sve_ld1bb_r_mte,
 +              gen_helper_sve_ld2bb_r_mte,
 +              gen_helper_sve_ld3bb_r_mte,
 +              gen_helper_sve_ld4bb_r_mte },
 +            { gen_helper_sve_ld1bhu_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1bsu_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1bdu_r_mte, NULL, NULL, NULL },
 +
 +            { gen_helper_sve_ld1sds_le_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1hh_le_r_mte,
 +              gen_helper_sve_ld2hh_le_r_mte,
 +              gen_helper_sve_ld3hh_le_r_mte,
 +              gen_helper_sve_ld4hh_le_r_mte },
 +            { gen_helper_sve_ld1hsu_le_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1hdu_le_r_mte, NULL, NULL, NULL },
 +
 +            { gen_helper_sve_ld1hds_le_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1hss_le_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1ss_le_r_mte,
 +              gen_helper_sve_ld2ss_le_r_mte,
 +              gen_helper_sve_ld3ss_le_r_mte,
 +              gen_helper_sve_ld4ss_le_r_mte },
 +            { gen_helper_sve_ld1sdu_le_r_mte, NULL, NULL, NULL },
 +
 +            { gen_helper_sve_ld1bds_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1bss_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1bhs_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1dd_le_r_mte,
 +              gen_helper_sve_ld2dd_le_r_mte,
 +              gen_helper_sve_ld3dd_le_r_mte,
 +              gen_helper_sve_ld4dd_le_r_mte } },
 +
 +          /* mte active, big-endian */
 +          { { gen_helper_sve_ld1bb_r_mte,
 +              gen_helper_sve_ld2bb_r_mte,
 +              gen_helper_sve_ld3bb_r_mte,
 +              gen_helper_sve_ld4bb_r_mte },
 +            { gen_helper_sve_ld1bhu_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1bsu_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1bdu_r_mte, NULL, NULL, NULL },
 +
 +            { gen_helper_sve_ld1sds_be_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1hh_be_r_mte,
 +              gen_helper_sve_ld2hh_be_r_mte,
 +              gen_helper_sve_ld3hh_be_r_mte,
 +              gen_helper_sve_ld4hh_be_r_mte },
 +            { gen_helper_sve_ld1hsu_be_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1hdu_be_r_mte, NULL, NULL, NULL },
 +
 +            { gen_helper_sve_ld1hds_be_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1hss_be_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1ss_be_r_mte,
 +              gen_helper_sve_ld2ss_be_r_mte,
 +              gen_helper_sve_ld3ss_be_r_mte,
 +              gen_helper_sve_ld4ss_be_r_mte },
 +            { gen_helper_sve_ld1sdu_be_r_mte, NULL, NULL, NULL },
 +
 +            { gen_helper_sve_ld1bds_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1bss_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1bhs_r_mte, NULL, NULL, NULL },
 +            { gen_helper_sve_ld1dd_be_r_mte,
 +              gen_helper_sve_ld2dd_be_r_mte,
 +              gen_helper_sve_ld3dd_be_r_mte,
 +              gen_helper_sve_ld4dd_be_r_mte } } },
      };
 -    gen_helper_gvec_mem *fn = fns[s->be_data == MO_BE][dtype][nreg];
 +    gen_helper_gvec_mem *fn
 +        = fns[s->mte_active[0]][s->be_data == MO_BE][dtype][nreg];
 -    /* While there are holes in the table, they are not
 +    /*
 +     * While there are holes in the table, they are not
       * accessible via the instruction encoding.
       */
      assert(fn != NULL);
 -    do_mem_zpa(s, zt, pg, addr, dtype, fn);
 +    do_mem_zpa(s, zt, pg, addr, dtype, nreg, false, fn);
  }
  static bool trans_LD_zprr(DisasContext *s, arg_rprr_load *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_LDFF1_zprr(DisasContext *s, arg_rprr_load *a)
          TCGv_i64 addr = new_tmp_a64(s);
          tcg_gen_shli_i64(addr, cpu_reg(s, a->rm), dtype_msz(a->dtype));
          tcg_gen_add_i64(addr, addr, cpu_reg_sp(s, a->rn));
 -        do_mem_zpa(s, a->rd, a->pg, addr, a->dtype,
 +        do_mem_zpa(s, a->rd, a->pg, addr, a->dtype, 0, false,
                     fns[s->be_data == MO_BE][a->dtype]);
      }
      return true;
@@ -XXX,XX +XXX,XX @@ static bool trans_LDNF1_zpri(DisasContext *s, arg_rpri_load *a)
          TCGv_i64 addr = new_tmp_a64(s);
          tcg_gen_addi_i64(addr, cpu_reg_sp(s, a->rn), off);
 -        do_mem_zpa(s, a->rd, a->pg, addr, a->dtype,
 +        do_mem_zpa(s, a->rd, a->pg, addr, a->dtype, 0, false,
                     fns[s->be_data == MO_BE][a->dtype]);
      }
      return true;
@@ -XXX,XX +XXX,XX @@ static void do_st_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
          fn = fn_multiple[be][nreg - 1][msz];
      }
      assert(fn != NULL);
 -    do_mem_zpa(s, zt, pg, addr, msz_dtype(s, msz), fn);
 +    do_mem_zpa(s, zt, pg, addr, msz_dtype(s, msz), 0, true, fn);
  }
  static bool trans_ST_zprr(DisasContext *s, arg_rprr_store *a)
 --
-.20.1
+.34.1

-[PULL 19/57] target/arm: Add MTE system registers
+[PULL 30/72] target/hppa: Set Float3NaNPropRule explicitly
-From: Richard Henderson <richard.henderson@linaro.org>
+Set the Float3NaNPropRule explicitly for HPPA, and remove the
 ifdef from pickNaNMulAdd().
-This is TFSRE0_EL1, TFSR_EL1, TFSR_EL2, TFSR_EL3,
+HPPA is the only target that was using the default branch of the
-RGSR_EL1, GCR_EL1, GMID_EL1, and PSTATE.TCO.
+ifdef ladder (other targets either do not use muladd or set
 default_nan_mode), so we can remove the ifdef fallback entirely now
 (allowing the "rule not set" case to fall into the default of the
 switch statement and assert).
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+We add a TODO note that the HPPA rule is probably wrong; this is
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+not a behavioural change for this refactoring.
-Message-id: 20200626033144.790098-8-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-26-peter.maydell@linaro.org
 ---
- target/arm/cpu.h           |  4 ++
+ target/hppa/fpu_helper.c       | 8 ++++++++
- target/arm/internals.h     |  9 ++++
+ fpu/softfloat-specialize.c.inc | 4 ----
- target/arm/helper.c        | 94 ++++++++++++++++++++++++++++++++++++++
+files changed, 8 insertions(+), 4 deletions(-)
  target/arm/translate-a64.c | 21 +++++++++
 files changed, 128 insertions(+)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
+diff --git a/target/hppa/fpu_helper.c b/target/hppa/fpu_helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/target/hppa/fpu_helper.c
-+++ b/target/arm/cpu.h
++++ b/target/hppa/fpu_helper.c
-@@ -XXX,XX +XXX,XX @@ typedef struct CPUARMState {
+@@ -XXX,XX +XXX,XX @@ void HELPER(loaded_fr0)(CPUHPPAState *env)
-         uint64_t pmccfiltr_el0; /* Performance Monitor Filter Register */
+      * HPPA does note implement a CPU reset method at all...
-         uint64_t vpidr_el2; /* Virtualization Processor ID Register */
+      */
-         uint64_t vmpidr_el2; /* Virtualization Multiprocessor ID Register */
+     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &env->fp_status);
-+        uint64_t tfsr_el[4]; /* tfsre0_el1 is index 0.  */
++    /*
-+        uint64_t gcr_el1;
++     * TODO: The HPPA architecture reference only documents its NaN
-+        uint64_t rgsr_el1;
++     * propagation rule for 2-operand operations. Testing on real hardware
-     } cp15;
++     * might be necessary to confirm whether this order for muladd is correct.
++     * Not preferring the SNaN is almost certainly incorrect as it diverges
-     struct {
++     * from the documented rules for 2-operand operations.
-@@ -XXX,XX +XXX,XX @@ void pmu_init(ARMCPU *cpu);
++     */
- #define PSTATE_SS (1U << 21)
++    set_float_3nan_prop_rule(float_3nan_prop_abc, &env->fp_status);
- #define PSTATE_PAN (1U << 22)
+     /* For inf * 0 + NaN, return the input NaN */
- #define PSTATE_UAO (1U << 23)
+     set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
-+#define PSTATE_TCO (1U << 25)
+ }
- #define PSTATE_V (1U << 28)
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
  #define PSTATE_C (1U << 29)
  #define PSTATE_Z (1U << 30)
 diff --git a/target/arm/internals.h b/target/arm/internals.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/internals.h
+--- a/fpu/softfloat-specialize.c.inc
-+++ b/target/arm/internals.h
++++ b/fpu/softfloat-specialize.c.inc
-@@ -XXX,XX +XXX,XX @@ static inline uint32_t aarch64_pstate_valid_mask(const ARMISARegisters *id)
+@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
      if (isar_feature_aa64_uao(id)) {
          valid |= PSTATE_UAO;
      }
 +    if (isar_feature_aa64_mte(id)) {
 +        valid |= PSTATE_TCO;
 +    }
      return valid;
  }
@@ -XXX,XX +XXX,XX @@ void arm_log_exception(int idx);
  #endif /* !CONFIG_USER_ONLY */
 +/*
 + * The log2 of the words in the tag block, for GMID_EL1.BS.
 + * The is the maximum, 256 bytes, which manipulates 64-bits of tags.
 + */
 +#define GMID_EL1_BS  6
 +
  #endif
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void define_arm_vh_e2h_redirects_aliases(ARMCPU *cpu)
          { K(3, 0,  1, 2, 0), K(3, 4,  1, 2, 0), K(3, 5, 1, 2, 0),
            "ZCR_EL1", "ZCR_EL2", "ZCR_EL12", isar_feature_aa64_sve },
 +        { K(3, 0,  5, 6, 0), K(3, 4,  5, 6, 0), K(3, 5, 5, 6, 0),
 +          "TFSR_EL1", "TFSR_EL2", "TFSR_EL12", isar_feature_aa64_mte },
 +
          /* TODO: ARMv8.2-SPE -- PMSCR_EL2 */
          /* TODO: ARMv8.4-Trace -- TRFCR_EL2 */
      };
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo dcpodp_reg[] = {
  };
  #endif /*CONFIG_USER_ONLY*/
 +static CPAccessResult access_aa64_tid5(CPUARMState *env, const ARMCPRegInfo *ri,
 +                                       bool isread)
 +{
 +    if ((arm_current_el(env) < 2) && (arm_hcr_el2_eff(env) & HCR_TID5)) {
 +        return CP_ACCESS_TRAP_EL2;
 +    }
 +
 +    return CP_ACCESS_OK;
 +}
 +
 +static CPAccessResult access_mte(CPUARMState *env, const ARMCPRegInfo *ri,
 +                                 bool isread)
 +{
 +    int el = arm_current_el(env);
 +
 +    if (el < 2 &&
 +        arm_feature(env, ARM_FEATURE_EL2) &&
 +        !(arm_hcr_el2_eff(env) & HCR_ATA)) {
 +        return CP_ACCESS_TRAP_EL2;
 +    }
 +    if (el < 3 &&
 +        arm_feature(env, ARM_FEATURE_EL3) &&
 +        !(env->cp15.scr_el3 & SCR_ATA)) {
 +        return CP_ACCESS_TRAP_EL3;
 +    }
 +    return CP_ACCESS_OK;
 +}
 +
 +static uint64_t tco_read(CPUARMState *env, const ARMCPRegInfo *ri)
 +{
 +    return env->pstate & PSTATE_TCO;
 +}
 +
 +static void tco_write(CPUARMState *env, const ARMCPRegInfo *ri, uint64_t val)
 +{
 +    env->pstate = (env->pstate & ~PSTATE_TCO) | (val & PSTATE_TCO);
 +}
 +
 +static const ARMCPRegInfo mte_reginfo[] = {
 +    { .name = "TFSRE0_EL1", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 3, .opc1 = 0, .crn = 5, .crm = 6, .opc2 = 1,
 +      .access = PL1_RW, .accessfn = access_mte,
 +      .fieldoffset = offsetof(CPUARMState, cp15.tfsr_el[0]) },
 +    { .name = "TFSR_EL1", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 3, .opc1 = 0, .crn = 5, .crm = 6, .opc2 = 0,
 +      .access = PL1_RW, .accessfn = access_mte,
 +      .fieldoffset = offsetof(CPUARMState, cp15.tfsr_el[1]) },
 +    { .name = "TFSR_EL2", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 3, .opc1 = 4, .crn = 5, .crm = 6, .opc2 = 0,
 +      .access = PL2_RW, .accessfn = access_mte,
 +      .fieldoffset = offsetof(CPUARMState, cp15.tfsr_el[2]) },
 +    { .name = "TFSR_EL3", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 3, .opc1 = 6, .crn = 5, .crm = 6, .opc2 = 0,
 +      .access = PL3_RW,
 +      .fieldoffset = offsetof(CPUARMState, cp15.tfsr_el[3]) },
 +    { .name = "RGSR_EL1", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 3, .opc1 = 0, .crn = 1, .crm = 0, .opc2 = 5,
 +      .access = PL1_RW, .accessfn = access_mte,
 +      .fieldoffset = offsetof(CPUARMState, cp15.rgsr_el1) },
 +    { .name = "GCR_EL1", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 3, .opc1 = 0, .crn = 1, .crm = 0, .opc2 = 6,
 +      .access = PL1_RW, .accessfn = access_mte,
 +      .fieldoffset = offsetof(CPUARMState, cp15.gcr_el1) },
 +    { .name = "GMID_EL1", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 3, .opc1 = 1, .crn = 0, .crm = 0, .opc2 = 4,
 +      .access = PL1_R, .accessfn = access_aa64_tid5,
 +      .type = ARM_CP_CONST, .resetvalue = GMID_EL1_BS },
 +    { .name = "TCO", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 3, .opc1 = 3, .crn = 4, .crm = 2, .opc2 = 7,
 +      .type = ARM_CP_NO_RAW,
 +      .access = PL0_RW, .readfn = tco_read, .writefn = tco_write },
 +    REGINFO_SENTINEL
 +};
 +
 +static const ARMCPRegInfo mte_tco_ro_reginfo[] = {
 +    { .name = "TCO", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 3, .opc1 = 3, .crn = 4, .crm = 2, .opc2 = 7,
 +      .type = ARM_CP_CONST, .access = PL0_RW, },
 +    REGINFO_SENTINEL
 +};
  #endif
  static CPAccessResult access_predinv(CPUARMState *env, const ARMCPRegInfo *ri,
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
          }
      }
- #endif /*CONFIG_USER_ONLY*/
-+
+-    if (rule == float_3nan_prop_none) {
-+    /*
+-        rule = float_3nan_prop_abc;
-+     * If full MTE is enabled, add all of the system registers.
+-    }
-+     * If only "instructions available at EL0" are enabled,
+-
-+     * then define only a RAZ/WI version of PSTATE.TCO.
+     assert(rule != float_3nan_prop_none);
-+     */
+     if (have_snan && (rule & R_3NAN_SNAN_MASK)) {
-+    if (cpu_isar_feature(aa64_mte, cpu)) {
+         /* We have at least one SNaN input and should prefer it */
 +        define_arm_cp_regs(cpu, mte_reginfo);
 +    } else if (cpu_isar_feature(aa64_mte_insn_reg, cpu)) {
 +        define_arm_cp_regs(cpu, mte_tco_ro_reginfo);
 +    }
  #endif
      if (cpu_isar_feature(any_predinv, cpu)) {
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void handle_msr_i(DisasContext *s, uint32_t insn,
          s->base.is_jmp = DISAS_UPDATE_EXIT;
          break;
 +    case 0x1c: /* TCO */
 +        if (dc_isar_feature(aa64_mte, s)) {
 +            /* Full MTE is enabled -- set the TCO bit as directed. */
 +            if (crm & 1) {
 +                set_pstate_bits(PSTATE_TCO);
 +            } else {
 +                clear_pstate_bits(PSTATE_TCO);
 +            }
 +            t1 = tcg_const_i32(s->current_el);
 +            gen_helper_rebuild_hflags_a64(cpu_env, t1);
 +            tcg_temp_free_i32(t1);
 +            /* Many factors, including TCO, go into MTE_ACTIVE. */
 +            s->base.is_jmp = DISAS_UPDATE_NOCHAIN;
 +        } else if (dc_isar_feature(aa64_mte_insn_reg, s)) {
 +            /* Only "instructions accessible at EL0" -- PSTATE.TCO is WI.  */
 +            s->base.is_jmp = DISAS_NEXT;
 +        } else {
 +            goto do_unallocated;
 +        }
 +        break;
 +
      default:
      do_unallocated:
          unallocated_encoding(s);
 --
-.20.1
+.34.1

-[PULL 34/57] target/arm: Move regime_tcr to internals.h
+[PULL 31/72] fpu: Remove use_first_nan field from float_status
-From: Richard Henderson <richard.henderson@linaro.org>
+The use_first_nan field in float_status was an xtensa-specific way to
 select at runtime from two different NaN propagation rules.  Now that
 xtensa is using the target-agnostic NaN propagation rule selection
 that we've just added, we can remove use_first_nan, because there is
 no longer any code that reads it.
-We will shortly need this in mte_helper.c as well.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20241202131347.498124-27-peter.maydell@linaro.org
 ---
  include/fpu/softfloat-helpers.h | 5 -----
  include/fpu/softfloat-types.h   | 1 -
  target/xtensa/fpu_helper.c      | 1 -
 files changed, 7 deletions(-)
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+diff --git a/include/fpu/softfloat-helpers.h b/include/fpu/softfloat-helpers.h
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20200626033144.790098-23-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/internals.h | 9 +++++++++
  target/arm/helper.c    | 9 ---------
 files changed, 9 insertions(+), 9 deletions(-)
 diff --git a/target/arm/internals.h b/target/arm/internals.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/internals.h
+--- a/include/fpu/softfloat-helpers.h
-+++ b/target/arm/internals.h
++++ b/include/fpu/softfloat-helpers.h
-@@ -XXX,XX +XXX,XX @@ static inline uint32_t regime_el(CPUARMState *env, ARMMMUIdx mmu_idx)
+@@ -XXX,XX +XXX,XX @@ static inline void set_snan_bit_is_one(bool val, float_status *status)
-     }
+     status->snan_bit_is_one = val;
  }
-+/* Return the TCR controlling this translation regime */
+-static inline void set_use_first_nan(bool val, float_status *status)
 +static inline TCR *regime_tcr(CPUARMState *env, ARMMMUIdx mmu_idx)
 +{
 +    if (mmu_idx == ARMMMUIdx_Stage2) {
 +        return &env->cp15.vtcr_el2;
 +    }
 +    return &env->cp15.tcr_el[regime_el(env, mmu_idx)];
 +}
 +
  /* Return the FSR value for a debug exception (watchpoint, hardware
   * breakpoint or BKPT insn) targeting the specified exception level.
   */
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static inline uint64_t regime_ttbr(CPUARMState *env, ARMMMUIdx mmu_idx,
  #endif /* !CONFIG_USER_ONLY */
 -/* Return the TCR controlling this translation regime */
 -static inline TCR *regime_tcr(CPUARMState *env, ARMMMUIdx mmu_idx)
 -{
--    if (mmu_idx == ARMMMUIdx_Stage2) {
+-    status->use_first_nan = val;
 -        return &env->cp15.vtcr_el2;
 -    }
 -    return &env->cp15.tcr_el[regime_el(env, mmu_idx)];
 -}
 -
- /* Convert a possible stage1+2 MMU index into the appropriate
+ static inline void set_no_signaling_nans(bool val, float_status *status)
-  * stage 1 MMU index
+ {
-  */
+     status->no_signaling_nans = val;
 diff --git a/include/fpu/softfloat-types.h b/include/fpu/softfloat-types.h
 index XXXXXXX..XXXXXXX 100644
 --- a/include/fpu/softfloat-types.h
 +++ b/include/fpu/softfloat-types.h
@@ -XXX,XX +XXX,XX @@ typedef struct float_status {
       * softfloat-specialize.inc.c)
       */
      bool snan_bit_is_one;
 -    bool use_first_nan;
      bool no_signaling_nans;
      /* should overflowed results subtract re_bias to its exponent? */
      bool rebias_overflow;
 diff --git a/target/xtensa/fpu_helper.c b/target/xtensa/fpu_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/xtensa/fpu_helper.c
 +++ b/target/xtensa/fpu_helper.c
@@ -XXX,XX +XXX,XX @@ static const struct {
  void xtensa_use_first_nan(CPUXtensaState *env, bool use_first)
  {
 -    set_use_first_nan(use_first, &env->fp_status);
      set_float_2nan_prop_rule(use_first ? float_2nan_prop_ab : float_2nan_prop_ba,
                               &env->fp_status);
      set_float_3nan_prop_rule(use_first ? float_3nan_prop_abc : float_3nan_prop_cba,
 --
-.20.1
+.34.1

-[PULL 43/57] target/arm: Tidy trans_LD1R_zpri
+[PULL 32/72] target/m68k: Don't pass NULL float_status to floatx80_default_nan()
-From: Richard Henderson <richard.henderson@linaro.org>
+Currently m68k_cpu_reset_hold() calls floatx80_default_nan(NULL)
 to get the NaN bit pattern to reset the FPU registers. This
 works because it happens that our implementation of
 floatx80_default_nan() doesn't actually look at the float_status
 pointer except for TARGET_MIPS. However, this isn't guaranteed,
 and to be able to remove the ifdef in floatx80_default_nan()
 we're going to need a real float_status here.
-Move the variable declarations to the top of the function,
+Rearrange m68k_cpu_reset_hold() so that we initialize env->fp_status
-but do not create a new label before sve_access_check.
+earlier, and thus can pass it to floatx80_default_nan().
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20200626033144.790098-32-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-28-peter.maydell@linaro.org
 ---
- target/arm/translate-sve.c | 12 +++++++-----
+ target/m68k/cpu.c | 12 +++++++-----
 file changed, 7 insertions(+), 5 deletions(-)
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+diff --git a/target/m68k/cpu.c b/target/m68k/cpu.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
+--- a/target/m68k/cpu.c
-+++ b/target/arm/translate-sve.c
++++ b/target/m68k/cpu.c
-@@ -XXX,XX +XXX,XX @@ static bool trans_LD1RQ_zpri(DisasContext *s, arg_rpri_load *a)
+@@ -XXX,XX +XXX,XX @@ static void m68k_cpu_reset_hold(Object *obj, ResetType type)
- /* Load and broadcast element.  */
+     CPUState *cs = CPU(obj);
- static bool trans_LD1R_zpri(DisasContext *s, arg_rpri_load *a)
+     M68kCPUClass *mcc = M68K_CPU_GET_CLASS(obj);
- {
+     CPUM68KState *env = cpu_env(cs);
--    if (!sve_access_check(s)) {
+-    floatx80 nan = floatx80_default_nan(NULL);
--        return true;
++    floatx80 nan;
      int i;
      if (mcc->parent_phases.hold) {
@@ -XXX,XX +XXX,XX @@ static void m68k_cpu_reset_hold(Object *obj, ResetType type)
  #else
      cpu_m68k_set_sr(env, SR_S | SR_I);
  #endif
 -    for (i = 0; i < 8; i++) {
 -        env->fregs[i].d = nan;
 -    }
--
+-    cpu_m68k_set_fpcr(env, 0);
-     unsigned vsz = vec_full_reg_size(s);
+     /*
-     unsigned psz = pred_full_reg_size(s);
+      * M68000 FAMILY PROGRAMMER'S REFERENCE MANUAL
-     unsigned esz = dtype_esz[a->dtype];
+      * 3.4 FLOATING-POINT INSTRUCTION DETAILS
-     unsigned msz = dtype_msz(a->dtype);
+@@ -XXX,XX +XXX,XX @@ static void m68k_cpu_reset_hold(Object *obj, ResetType type)
--    TCGLabel *over = gen_new_label();
+      * preceding paragraph for nonsignaling NaNs.
-+    TCGLabel *over;
+      */
-     TCGv_i64 temp, clean_addr;
+     set_float_2nan_prop_rule(float_2nan_prop_ab, &env->fp_status);
++
-+    if (!sve_access_check(s)) {
++    nan = floatx80_default_nan(&env->fp_status);
-+        return true;
++    for (i = 0; i < 8; i++) {
 +        env->fregs[i].d = nan;
 +    }
-+
++    cpu_m68k_set_fpcr(env, 0);
-+    over = gen_new_label();
+     env->fpsr = 0;
-+
-     /* If the guarding predicate has no bits set, no load occurs.  */
+     /* TODO: We should set PC from the interrupt vector.  */
      if (psz <= 8) {
          /* Reduce the pred_esz_masks value simply to reduce the
 --
-.20.1
+.34.1

-[PULL 10/57] hw/arm/aspeed: Describe each PCA9552 device
+[PULL 33/72] softfloat: Create floatx80 default NaN from parts64_default_nan
-From: Philippe Mathieu-Daudé <f4bug@amsat.org>
+We create our 128-bit default NaN by calling parts64_default_nan()
 and then adjusting the result.  We can do the same trick for creating
 the floatx80 default NaN, which lets us drop a target ifdef.
-We have 2 distinct PCA9552 devices. Set their description
+floatx80 is used only by:
-to distinguish them when looking at the trace events.
+ i386
  m68k
  arm nwfpe old floating-point emulation emulation support
     (which is essentially dead, especially the parts involving floatx80)
  PPC (only in the xsrqpxp instruction, which just rounds an input
     value by converting to floatx80 and back, so will never generate
     the default NaN)
-Description name taken from:
+The floatx80 default NaN as currently implemented is:
-https://github.com/open-power/witherspoon-xml/blob/master/witherspoon.xml
+ m68k: sign = 0, exp = 1...1, int = 1, frac = 1....1
  i386: sign = 1, exp = 1...1, int = 1, frac = 10...0
-Reviewed-by: Cédric Le Goater <clg@kaod.org>
+These are the same as the parts64_default_nan for these architectures.
-Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
-Reviewed-by: Corey Minyard <cminyard@mvista.com>
+This is technically a possible behaviour change for arm linux-user
-Reviewed-by: Markus Armbruster <armbru@redhat.com>
+nwfpe emulation emulation, because the default NaN will now have the
-Tested-by: Cédric Le Goater <clg@kaod.org>
+sign bit clear.  But we were already generating a different floatx80
-Message-id: 20200623072723.6324-8-f4bug@amsat.org
+default NaN from the real kernel emulation we are supposedly
 following, which appears to use an all-bits-1 value:
  https://elixir.bootlin.com/linux/v6.12/source/arch/arm/nwfpe/softfloat-specialize#L267
 This won't affect the only "real" use of the nwfpe emulation, which
 is ancient binaries that used it as part of the old floating point
 calling convention; that only uses loads and stores of 32 and 64 bit
 floats, not any of the floatx80 behaviour the original hardware had.
 We also get the nwfpe float64 default NaN value wrong:
  https://elixir.bootlin.com/linux/v6.12/source/arch/arm/nwfpe/softfloat-specialize#L166
 so if we ever cared about this obscure corner the right fix would be
 to correct that so nwfpe used its own default-NaN setting rather
 than the Arm VFP one.
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-29-peter.maydell@linaro.org
 ---
- hw/arm/aspeed.c | 13 +++++++++----
+ fpu/softfloat-specialize.c.inc | 20 ++++++++++----------
-file changed, 9 insertions(+), 4 deletions(-)
+file changed, 10 insertions(+), 10 deletions(-)
-diff --git a/hw/arm/aspeed.c b/hw/arm/aspeed.c
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 index XXXXXXX..XXXXXXX 100644
---- a/hw/arm/aspeed.c
+--- a/fpu/softfloat-specialize.c.inc
-+++ b/hw/arm/aspeed.c
++++ b/fpu/softfloat-specialize.c.inc
-@@ -XXX,XX +XXX,XX @@ static void witherspoon_bmc_i2c_init(AspeedMachineState *bmc)
+@@ -XXX,XX +XXX,XX @@ static void parts128_silence_nan(FloatParts128 *p, float_status *status)
  floatx80 floatx80_default_nan(float_status *status)
  {
-     AspeedSoCState *soc = &bmc->soc;
+     floatx80 r;
-     uint8_t *eeprom_buf = g_malloc0(8 * 1024);
++    /*
-+    DeviceState *dev;
++     * Extrapolate from the choices made by parts64_default_nan to fill
++     * in the floatx80 format. We assume that floatx80's explicit
-     /* Bus 3: TODO bmp280@77 */
++     * integer bit is always set (this is true for i386 and m68k,
-     /* Bus 3: TODO max31785@52 */
++     * which are the only real users of this format).
-     /* Bus 3: TODO dps310@76 */
++     */
--    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 3), TYPE_PCA9552,
++    FloatParts64 p64;
--                     0x60);
++    parts64_default_nan(&p64, status);
-+    dev = i2c_try_create_slave(TYPE_PCA9552, 0x60);
-+    qdev_prop_set_string(dev, "description", "pca1");
+-    /* None of the targets that have snan_bit_is_one use floatx80.  */
-+    i2c_realize_and_unref(dev, aspeed_i2c_get_bus(DEVICE(&soc->i2c), 3),
+-    assert(!snan_bit_is_one(status));
-+                          &error_fatal);
+-#if defined(TARGET_M68K)
+-    r.low = UINT64_C(0xFFFFFFFFFFFFFFFF);
-     i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 4), "tmp423", 0x4c);
+-    r.high = 0x7FFF;
-     i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 5), "tmp423", 0x4c);
+-#else
-@@ -XXX,XX +XXX,XX @@ static void witherspoon_bmc_i2c_init(AspeedMachineState *bmc)
+-    /* X86 */
+-    r.low = UINT64_C(0xC000000000000000);
-     smbus_eeprom_init_one(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 11), 0x51,
+-    r.high = 0xFFFF;
-                           eeprom_buf);
+-#endif
--    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 11), TYPE_PCA9552,
++    r.high = 0x7FFF | (p64.sign << 15);
--                     0x60);
++    r.low = (1ULL << DECOMPOSED_BINARY_POINT) | p64.frac;
-+    dev = i2c_try_create_slave(TYPE_PCA9552, 0x60);
+     return r;
 +    qdev_prop_set_string(dev, "description", "pca0");
 +    i2c_realize_and_unref(dev, aspeed_i2c_get_bus(DEVICE(&soc->i2c), 11),
 +                          &error_fatal);
      /* Bus 11: TODO ucd90160@64 */
  }
 --
-.20.1
+.34.1

-[PULL 51/57] target/arm: Implement data cache set allocation tags
+[PULL 34/72] target/loongarch: Use normal float_status in fclass_s and fclass_d helpers
-From: Richard Henderson <richard.henderson@linaro.org>
+In target/loongarch's helper_fclass_s() and helper_fclass_d() we pass
 a zero-initialized float_status struct to float32_is_quiet_nan() and
 float64_is_quiet_nan(), with the cryptic comment "for
 snan_bit_is_one".
-This is DC GVA and DC GZVA, and the tag check for DC ZVA.
+This pattern appears to have been copied from target/riscv, where it
 is used because the functions there do not have ready access to the
 CPU state struct. The comment presumably refers to the fact that the
 main reason the is_quiet_nan() functions want the float_state is
 because they want to know about the snan_bit_is_one config.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+In the loongarch helpers, though, we have the CPU state struct
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+to hand. Use the usual env->fp_status here. This avoids our needing
-Message-id: 20200626033144.790098-40-richard.henderson@linaro.org
+to track that we need to update the initializer of the local
 float_status structs when the core softfloat code adds new
 options for targets to configure their behaviour.
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-30-peter.maydell@linaro.org
 ---
- target/arm/cpu.h           |  4 +++-
+ target/loongarch/tcg/fpu_helper.c | 6 ++----
- target/arm/helper.c        | 16 ++++++++++++++++
+file changed, 2 insertions(+), 4 deletions(-)
  target/arm/translate-a64.c | 39 ++++++++++++++++++++++++++++++++++++++
 files changed, 58 insertions(+), 1 deletion(-)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
+diff --git a/target/loongarch/tcg/fpu_helper.c b/target/loongarch/tcg/fpu_helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/target/loongarch/tcg/fpu_helper.c
-+++ b/target/arm/cpu.h
++++ b/target/loongarch/tcg/fpu_helper.c
-@@ -XXX,XX +XXX,XX @@ static inline uint64_t cpreg_to_kvm_id(uint32_t cpregid)
+@@ -XXX,XX +XXX,XX @@ uint64_t helper_fclass_s(CPULoongArchState *env, uint64_t fj)
- #define ARM_CP_NZCV              (ARM_CP_SPECIAL | 0x0300)
+     } else if (float32_is_zero_or_denormal(f)) {
- #define ARM_CP_CURRENTEL         (ARM_CP_SPECIAL | 0x0400)
+         return sign ? 1 << 4 : 1 << 8;
- #define ARM_CP_DC_ZVA            (ARM_CP_SPECIAL | 0x0500)
+     } else if (float32_is_any_nan(f)) {
--#define ARM_LAST_SPECIAL         ARM_CP_DC_ZVA
+-        float_status s = { }; /* for snan_bit_is_one */
-+#define ARM_CP_DC_GVA            (ARM_CP_SPECIAL | 0x0600)
+-        return float32_is_quiet_nan(f, &s) ? 1 << 1 : 1 << 0;
-+#define ARM_CP_DC_GZVA           (ARM_CP_SPECIAL | 0x0700)
++        return float32_is_quiet_nan(f, &env->fp_status) ? 1 << 1 : 1 << 0;
-+#define ARM_LAST_SPECIAL         ARM_CP_DC_GZVA
+     } else {
- #define ARM_CP_FPU               0x1000
+         return sign ? 1 << 3 : 1 << 7;
- #define ARM_CP_SVE               0x2000
+     }
- #define ARM_CP_NO_GDB            0x4000
+@@ -XXX,XX +XXX,XX @@ uint64_t helper_fclass_d(CPULoongArchState *env, uint64_t fj)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+     } else if (float64_is_zero_or_denormal(f)) {
-index XXXXXXX..XXXXXXX 100644
+         return sign ? 1 << 4 : 1 << 8;
---- a/target/arm/helper.c
+     } else if (float64_is_any_nan(f)) {
-+++ b/target/arm/helper.c
+-        float_status s = { }; /* for snan_bit_is_one */
-@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo mte_el0_cacheop_reginfo[] = {
+-        return float64_is_quiet_nan(f, &s) ? 1 << 1 : 1 << 0;
-       .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 14, .opc2 = 5,
++        return float64_is_quiet_nan(f, &env->fp_status) ? 1 << 1 : 1 << 0;
-       .type = ARM_CP_NOP, .access = PL0_W,
+     } else {
-       .accessfn = aa64_cacheop_poc_access },
+         return sign ? 1 << 3 : 1 << 7;
 +    { .name = "DC_GVA", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 4, .opc2 = 3,
 +      .access = PL0_W, .type = ARM_CP_DC_GVA,
 +#ifndef CONFIG_USER_ONLY
 +      /* Avoid overhead of an access check that always passes in user-mode */
 +      .accessfn = aa64_zva_access,
 +#endif
 +    },
 +    { .name = "DC_GZVA", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 4, .opc2 = 4,
 +      .access = PL0_W, .type = ARM_CP_DC_GZVA,
 +#ifndef CONFIG_USER_ONLY
 +      /* Avoid overhead of an access check that always passes in user-mode */
 +      .accessfn = aa64_zva_access,
 +#endif
 +    },
      REGINFO_SENTINEL
  };
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void handle_sys(DisasContext *s, uint32_t insn, bool isread,
          }
          gen_helper_dc_zva(cpu_env, tcg_rt);
          return;
 +    case ARM_CP_DC_GVA:
 +        {
 +            TCGv_i64 clean_addr, tag;
 +
 +            /*
 +             * DC_GVA, like DC_ZVA, requires that we supply the original
 +             * pointer for an invalid page.  Probe that address first.
 +             */
 +            tcg_rt = cpu_reg(s, rt);
 +            clean_addr = clean_data_tbi(s, tcg_rt);
 +            gen_probe_access(s, clean_addr, MMU_DATA_STORE, MO_8);
 +
 +            if (s->ata) {
 +                /* Extract the tag from the register to match STZGM.  */
 +                tag = tcg_temp_new_i64();
 +                tcg_gen_shri_i64(tag, tcg_rt, 56);
 +                gen_helper_stzgm_tags(cpu_env, clean_addr, tag);
 +                tcg_temp_free_i64(tag);
 +            }
 +        }
 +        return;
 +    case ARM_CP_DC_GZVA:
 +        {
 +            TCGv_i64 clean_addr, tag;
 +
 +            /* For DC_GZVA, we can rely on DC_ZVA for the proper fault. */
 +            tcg_rt = cpu_reg(s, rt);
 +            clean_addr = clean_data_tbi(s, tcg_rt);
 +            gen_helper_dc_zva(cpu_env, clean_addr);
 +
 +            if (s->ata) {
 +                /* Extract the tag from the register to match STZGM.  */
 +                tag = tcg_temp_new_i64();
 +                tcg_gen_shri_i64(tag, tcg_rt, 56);
 +                gen_helper_stzgm_tags(cpu_env, clean_addr, tag);
 +                tcg_temp_free_i64(tag);
 +            }
 +        }
 +        return;
      default:
          break;
      }
 --
-.20.1
+.34.1

-New patch
+[PULL 35/72] target/m68k: In frem helper, initialize local float_status from env->fp_status
+In the frem helper, we have a local float_status because we want to
+execute the floatx80_div() with a custom rounding mode.  Instead of
+zero-initializing the local float_status and then having to set it up
+with the m68k standard behaviour (including the NaN propagation rule
+and copying the rounding precision from env->fp_status), initialize
+it as a complete copy of env->fp_status. This will avoid our having
+to add new code in this function for every new config knob we add
+to fp_status.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-31-peter.maydell@linaro.org
+---
+ target/m68k/fpu_helper.c | 6 ++----
+file changed, 2 insertions(+), 4 deletions(-)
+diff --git a/target/m68k/fpu_helper.c b/target/m68k/fpu_helper.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/m68k/fpu_helper.c
++++ b/target/m68k/fpu_helper.c
+@@ -XXX,XX +XXX,XX @@ void HELPER(frem)(CPUM68KState *env, FPReg *res, FPReg *val0, FPReg *val1)
+     fp_rem = floatx80_rem(val1->d, val0->d, &env->fp_status);
+     if (!floatx80_is_any_nan(fp_rem)) {
+-        float_status fp_status = { };
++        /* Use local temporary fp_status to set different rounding mode */
++        float_status fp_status = env->fp_status;
+         uint32_t quotient;
+         int sign;
+         /* Calculate quotient directly using round to nearest mode */
+-        set_float_2nan_prop_rule(float_2nan_prop_ab, &fp_status);
+         set_float_rounding_mode(float_round_nearest_even, &fp_status);
+-        set_floatx80_rounding_precision(
+-            get_floatx80_rounding_precision(&env->fp_status), &fp_status);
+         fp_quot.d = floatx80_div(val1->d, val0->d, &fp_status);
+         sign = extractFloatx80Sign(fp_quot.d);
+--
+.34.1

-[PULL 42/57] target/arm: Use mte_check1 for sve LD1R
+[PULL 36/72] target/m68k: Init local float_status from env fp_status in gdb get/set reg
-From: Richard Henderson <richard.henderson@linaro.org>
+In cf_fpu_gdb_get_reg() and cf_fpu_gdb_set_reg() we do the conversion
 from float64 to floatx80 using a scratch float_status, because we
 don't want the conversion to affect the CPU's floating point exception
 status. Currently we use a zero-initialized float_status. This will
 get steadily more awkward as we add config knobs to float_status
 that the target must initialize. Avoid having to add any of that
 configuration here by instead initializing our local float_status
 from the env->fp_status.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20200626033144.790098-31-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-32-peter.maydell@linaro.org
 ---
- target/arm/translate-sve.c | 6 ++++--
+ target/m68k/helper.c | 6 ++++--
 file changed, 4 insertions(+), 2 deletions(-)
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+diff --git a/target/m68k/helper.c b/target/m68k/helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
+--- a/target/m68k/helper.c
-+++ b/target/arm/translate-sve.c
++++ b/target/m68k/helper.c
-@@ -XXX,XX +XXX,XX @@ static bool trans_LD1R_zpri(DisasContext *s, arg_rpri_load *a)
+@@ -XXX,XX +XXX,XX @@ static int cf_fpu_gdb_get_reg(CPUState *cs, GByteArray *mem_buf, int n)
-     unsigned esz = dtype_esz[a->dtype];
+     CPUM68KState *env = &cpu->env;
-     unsigned msz = dtype_msz(a->dtype);
-     TCGLabel *over = gen_new_label();
+     if (n < 8) {
--    TCGv_i64 temp;
+-        float_status s = {};
-+    TCGv_i64 temp, clean_addr;
++        /* Use scratch float_status so any exceptions don't change CPU state */
++        float_status s = env->fp_status;
-     /* If the guarding predicate has no bits set, no load occurs.  */
+         return gdb_get_reg64(mem_buf, floatx80_to_float64(env->fregs[n].d, &s));
-     if (psz <= 8) {
+     }
-@@ -XXX,XX +XXX,XX @@ static bool trans_LD1R_zpri(DisasContext *s, arg_rpri_load *a)
+     switch (n) {
-     /* Load the data.  */
+@@ -XXX,XX +XXX,XX @@ static int cf_fpu_gdb_set_reg(CPUState *cs, uint8_t *mem_buf, int n)
-     temp = tcg_temp_new_i64();
+     CPUM68KState *env = &cpu->env;
-     tcg_gen_addi_i64(temp, cpu_reg_sp(s, a->rn), a->imm << msz);
--    tcg_gen_qemu_ld_i64(temp, temp, get_mem_index(s),
+     if (n < 8) {
-+    clean_addr = gen_mte_check1(s, temp, false, true, msz);
+-        float_status s = {};
-+
++        /* Use scratch float_status so any exceptions don't change CPU state */
-+    tcg_gen_qemu_ld_i64(temp, clean_addr, get_mem_index(s),
++        float_status s = env->fp_status;
-                         s->be_data | dtype_mop[a->dtype]);
+         env->fregs[n].d = float64_to_floatx80(ldq_be_p(mem_buf), &s);
+         return 8;
-     /* Broadcast to *all* elements.  */
+     }
 --
-.20.1
+.34.1

-[PULL 47/57] target/arm: Add mte helpers for sve scalar + int ff/nf loads
+[PULL 37/72] target/sparc: Initialize local scratch float_status from env->fp_status
-From: Richard Henderson <richard.henderson@linaro.org>
+In the helper functions flcmps and flcmpd we use a scratch float_status
 so that we don't change the CPU state if the comparison raises any
 floating point exception flags. Instead of zero-initializing this
 scratch float_status, initialize it as a copy of env->fp_status. This
 avoids the need to explicitly initialize settings like the NaN
 propagation rule or others we might add to softfloat in future.
-Because the elements are sequential, we can eliminate many tests all
+To do this we need to pass the CPU env pointer in to the helper.
 at once when the tag hits TCMA, or if the page(s) are not Tagged.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20200626033144.790098-36-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-33-peter.maydell@linaro.org
 ---
- target/arm/helper-sve.h    |  98 ++++++++++++++++
+ target/sparc/helper.h     | 4 ++--
- target/arm/sve_helper.c    |  99 ++++++++++++++--
+ target/sparc/fop_helper.c | 8 ++++----
- target/arm/translate-sve.c | 232 +++++++++++++++++++++++++------------
+ target/sparc/translate.c  | 4 ++--
-files changed, 343 insertions(+), 86 deletions(-)
+files changed, 8 insertions(+), 8 deletions(-)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
+diff --git a/target/sparc/helper.h b/target/sparc/helper.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
+--- a/target/sparc/helper.h
-+++ b/target/arm/helper-sve.h
++++ b/target/sparc/helper.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_4(sve_ldff1sds_be_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_3(fcmpd, TCG_CALL_NO_WG, i32, env, f64, f64)
- DEF_HELPER_FLAGS_4(sve_ldff1dd_le_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+ DEF_HELPER_FLAGS_3(fcmped, TCG_CALL_NO_WG, i32, env, f64, f64)
- DEF_HELPER_FLAGS_4(sve_ldff1dd_be_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+ DEF_HELPER_FLAGS_3(fcmpq, TCG_CALL_NO_WG, i32, env, i128, i128)
+ DEF_HELPER_FLAGS_3(fcmpeq, TCG_CALL_NO_WG, i32, env, i128, i128)
-+DEF_HELPER_FLAGS_4(sve_ldff1bb_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+-DEF_HELPER_FLAGS_2(flcmps, TCG_CALL_NO_RWG_SE, i32, f32, f32)
-+DEF_HELPER_FLAGS_4(sve_ldff1bhu_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+-DEF_HELPER_FLAGS_2(flcmpd, TCG_CALL_NO_RWG_SE, i32, f64, f64)
-+DEF_HELPER_FLAGS_4(sve_ldff1bsu_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
++DEF_HELPER_FLAGS_3(flcmps, TCG_CALL_NO_RWG_SE, i32, env, f32, f32)
-+DEF_HELPER_FLAGS_4(sve_ldff1bdu_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
++DEF_HELPER_FLAGS_3(flcmpd, TCG_CALL_NO_RWG_SE, i32, env, f64, f64)
-+DEF_HELPER_FLAGS_4(sve_ldff1bhs_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+ DEF_HELPER_2(raise_exception, noreturn, env, int)
-+DEF_HELPER_FLAGS_4(sve_ldff1bss_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ldff1bds_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+ DEF_HELPER_FLAGS_3(faddd, TCG_CALL_NO_WG, f64, env, f64, f64)
-+
+diff --git a/target/sparc/fop_helper.c b/target/sparc/fop_helper.c
 +DEF_HELPER_FLAGS_4(sve_ldff1hh_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldff1hsu_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldff1hdu_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldff1hss_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldff1hds_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ldff1hh_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldff1hsu_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldff1hdu_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldff1hss_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldff1hds_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ldff1ss_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldff1sdu_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldff1sds_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ldff1ss_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldff1sdu_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldff1sds_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ldff1dd_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldff1dd_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +
  DEF_HELPER_FLAGS_4(sve_ldnf1bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
  DEF_HELPER_FLAGS_4(sve_ldnf1bhu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
  DEF_HELPER_FLAGS_4(sve_ldnf1bsu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_4(sve_ldnf1sds_be_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
  DEF_HELPER_FLAGS_4(sve_ldnf1dd_le_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
  DEF_HELPER_FLAGS_4(sve_ldnf1dd_be_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1bb_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1bhu_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1bsu_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1bdu_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1bhs_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1bss_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1bds_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ldnf1hh_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1hsu_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1hdu_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1hss_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1hds_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ldnf1hh_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1hsu_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1hdu_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1hss_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1hds_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ldnf1ss_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1sdu_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1sds_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ldnf1ss_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1sdu_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1sds_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ldnf1dd_le_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1dd_be_r_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, tl, i32)
 +
  DEF_HELPER_FLAGS_4(sve_st1bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
  DEF_HELPER_FLAGS_4(sve_st2bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
  DEF_HELPER_FLAGS_4(sve_st3bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve_helper.c
+--- a/target/sparc/fop_helper.c
-+++ b/target/arm/sve_helper.c
++++ b/target/sparc/fop_helper.c
-@@ -XXX,XX +XXX,XX @@ static void record_fault(CPUARMState *env, uintptr_t i, uintptr_t oprsz)
+@@ -XXX,XX +XXX,XX @@ uint32_t helper_fcmpeq(CPUSPARCState *env, Int128 src1, Int128 src2)
-  */
+     return finish_fcmp(env, r, GETPC());
  static inline QEMU_ALWAYS_INLINE
  void sve_ldnfff1_r(CPUARMState *env, void *vg, const target_ulong addr,
 -                   uint32_t desc, const uintptr_t retaddr,
 +                   uint32_t desc, const uintptr_t retaddr, uint32_t mtedesc,
                     const int esz, const int msz, const SVEContFault fault,
                     sve_ldst1_host_fn *host_fn,
                     sve_ldst1_tlb_fn *tlb_fn)
@@ -XXX,XX +XXX,XX @@ void sve_ldnfff1_r(CPUARMState *env, void *vg, const target_ulong addr,
      mem_off = info.mem_off_first[0];
      flags = info.page[0].flags;
 +    /*
 +     * Disable MTE checking if the Tagged bit is not set.  Since TBI must
 +     * be set within MTEDESC for MTE, !mtedesc => !mte_active.
 +     */
 +    if (arm_tlb_mte_tagged(&info.page[0].attrs)) {
 +        mtedesc = 0;
 +    }
 +
      if (fault == FAULT_FIRST) {
 +        /* Trapping mte check for the first-fault element.  */
 +        if (mtedesc) {
 +            mte_check1(env, mtedesc, addr + mem_off, retaddr);
 +        }
 +
          /*
           * Special handling of the first active element,
           * if it crosses a page boundary or is MMIO.
           */
          bool is_split = mem_off == info.mem_off_split;
 -        /* TODO: MTE check. */
          if (unlikely(flags != 0) || unlikely(is_split)) {
              /*
               * Use the slow path for cross-page handling.
@@ -XXX,XX +XXX,XX @@ void sve_ldnfff1_r(CPUARMState *env, void *vg, const target_ulong addr,
                  /* Watchpoint hit, see below. */
                  goto do_fault;
              }
 -            /* TODO: MTE check. */
 +            if (mtedesc && !mte_probe1(env, mtedesc, addr + mem_off)) {
 +                goto do_fault;
 +            }
              /*
               * Use the slow path for cross-page handling.
               * This is RAM, without a watchpoint, and will not trap.
@@ -XXX,XX +XXX,XX @@ void sve_ldnfff1_r(CPUARMState *env, void *vg, const target_ulong addr,
                       & BP_MEM_READ)) {
                      goto do_fault;
                  }
 -                /* TODO: MTE check. */
 +                if (mtedesc && !mte_probe1(env, mtedesc, addr + mem_off)) {
 +                    goto do_fault;
 +                }
                  host_fn(vd, reg_off, host + mem_off);
              }
              reg_off += 1 << esz;
@@ -XXX,XX +XXX,XX @@ void sve_ldnfff1_r(CPUARMState *env, void *vg, const target_ulong addr,
      record_fault(env, reg_off, reg_max);
  }
--#define DO_LDFF1_LDNF1_1(PART, ESZ) \
+-uint32_t helper_flcmps(float32 src1, float32 src2)
-+static inline QEMU_ALWAYS_INLINE
++uint32_t helper_flcmps(CPUSPARCState *env, float32 src1, float32 src2)
-+void sve_ldnfff1_r_mte(CPUARMState *env, void *vg, target_ulong addr,
+ {
-+                       uint32_t desc, const uintptr_t retaddr,
+     /*
-+                       const int esz, const int msz, const SVEContFault fault,
+      * FLCMP never raises an exception nor modifies any FSR fields.
-+                       sve_ldst1_host_fn *host_fn,
+      * Perform the comparison with a dummy fp environment.
-+                       sve_ldst1_tlb_fn *tlb_fn)
+      */
-+{
+-    float_status discard = { };
-+    uint32_t mtedesc = desc >> (SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
++    float_status discard = env->fp_status;
-+    int bit55 = extract64(addr, 55, 1);
+     FloatRelation r;
-+
-+    /* Remove mtedesc from the normal sve descriptor. */
+     set_float_2nan_prop_rule(float_2nan_prop_s_ba, &discard);
-+    desc = extract32(desc, 0, SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
+@@ -XXX,XX +XXX,XX @@ uint32_t helper_flcmps(float32 src1, float32 src2)
-+
+     g_assert_not_reached();
 +    /* Perform gross MTE suppression early. */
 +    if (!tbi_check(desc, bit55) ||
 +        tcma_check(desc, bit55, allocation_tag_from_addr(addr))) {
 +        mtedesc = 0;
 +    }
 +
 +    sve_ldnfff1_r(env, vg, addr, desc, retaddr, mtedesc,
 +                  esz, msz, fault, host_fn, tlb_fn);
 +}
 +
 +#define DO_LDFF1_LDNF1_1(PART, ESZ)                                     \
  void HELPER(sve_ldff1##PART##_r)(CPUARMState *env, void *vg,            \
                                   target_ulong addr, uint32_t desc)      \
  {                                                                       \
 -    sve_ldnfff1_r(env, vg, addr, desc, GETPC(), ESZ, MO_8, FAULT_FIRST, \
 +    sve_ldnfff1_r(env, vg, addr, desc, GETPC(), 0, ESZ, MO_8, FAULT_FIRST, \
                    sve_ld1##PART##_host, sve_ld1##PART##_tlb);           \
  }                                                                       \
  void HELPER(sve_ldnf1##PART##_r)(CPUARMState *env, void *vg,            \
                                   target_ulong addr, uint32_t desc)      \
  {                                                                       \
 -    sve_ldnfff1_r(env, vg, addr, desc, GETPC(), ESZ, MO_8, FAULT_NO,    \
 +    sve_ldnfff1_r(env, vg, addr, desc, GETPC(), 0, ESZ, MO_8, FAULT_NO, \
 +                  sve_ld1##PART##_host, sve_ld1##PART##_tlb);           \
 +}                                                                       \
 +void HELPER(sve_ldff1##PART##_r_mte)(CPUARMState *env, void *vg,        \
 +                                     target_ulong addr, uint32_t desc)  \
 +{                                                                       \
 +    sve_ldnfff1_r_mte(env, vg, addr, desc, GETPC(), ESZ, MO_8, FAULT_FIRST, \
 +                      sve_ld1##PART##_host, sve_ld1##PART##_tlb);       \
 +}                                                                       \
 +void HELPER(sve_ldnf1##PART##_r_mte)(CPUARMState *env, void *vg,        \
 +                                     target_ulong addr, uint32_t desc)  \
 +{                                                                       \
 +    sve_ldnfff1_r_mte(env, vg, addr, desc, GETPC(), ESZ, MO_8, FAULT_NO, \
                    sve_ld1##PART##_host, sve_ld1##PART##_tlb);           \
  }
--#define DO_LDFF1_LDNF1_2(PART, ESZ, MSZ) \
+-uint32_t helper_flcmpd(float64 src1, float64 src2)
-+#define DO_LDFF1_LDNF1_2(PART, ESZ, MSZ)                                \
++uint32_t helper_flcmpd(CPUSPARCState *env, float64 src1, float64 src2)
- void HELPER(sve_ldff1##PART##_le_r)(CPUARMState *env, void *vg,         \
+ {
-                                     target_ulong addr, uint32_t desc)   \
+-    float_status discard = { };
- {                                                                       \
++    float_status discard = env->fp_status;
--    sve_ldnfff1_r(env, vg, addr, desc, GETPC(), ESZ, MSZ, FAULT_FIRST,  \
+     FloatRelation r;
-+    sve_ldnfff1_r(env, vg, addr, desc, GETPC(), 0, ESZ, MSZ, FAULT_FIRST, \
-                   sve_ld1##PART##_le_host, sve_ld1##PART##_le_tlb);     \
+     set_float_2nan_prop_rule(float_2nan_prop_s_ba, &discard);
- }                                                                       \
+diff --git a/target/sparc/translate.c b/target/sparc/translate.c
- void HELPER(sve_ldnf1##PART##_le_r)(CPUARMState *env, void *vg,         \
+index XXXXXXX..XXXXXXX 100644
-                                     target_ulong addr, uint32_t desc)   \
+--- a/target/sparc/translate.c
- {                                                                       \
++++ b/target/sparc/translate.c
--    sve_ldnfff1_r(env, vg, addr, desc, GETPC(), ESZ, MSZ, FAULT_NO,     \
+@@ -XXX,XX +XXX,XX @@ static bool trans_FLCMPs(DisasContext *dc, arg_FLCMPs *a)
-+    sve_ldnfff1_r(env, vg, addr, desc, GETPC(), 0, ESZ, MSZ, FAULT_NO,  \
-                   sve_ld1##PART##_le_host, sve_ld1##PART##_le_tlb);     \
+     src1 = gen_load_fpr_F(dc, a->rs1);
- }                                                                       \
+     src2 = gen_load_fpr_F(dc, a->rs2);
- void HELPER(sve_ldff1##PART##_be_r)(CPUARMState *env, void *vg,         \
+-    gen_helper_flcmps(cpu_fcc[a->cc], src1, src2);
-                                     target_ulong addr, uint32_t desc)   \
++    gen_helper_flcmps(cpu_fcc[a->cc], tcg_env, src1, src2);
- {                                                                       \
+     return advance_pc(dc);
 -    sve_ldnfff1_r(env, vg, addr, desc, GETPC(), ESZ, MSZ, FAULT_FIRST,  \
 +    sve_ldnfff1_r(env, vg, addr, desc, GETPC(), 0, ESZ, MSZ, FAULT_FIRST, \
                    sve_ld1##PART##_be_host, sve_ld1##PART##_be_tlb);     \
  }                                                                       \
  void HELPER(sve_ldnf1##PART##_be_r)(CPUARMState *env, void *vg,         \
                                      target_ulong addr, uint32_t desc)   \
  {                                                                       \
 -    sve_ldnfff1_r(env, vg, addr, desc, GETPC(), ESZ, MSZ, FAULT_NO,     \
 +    sve_ldnfff1_r(env, vg, addr, desc, GETPC(), 0, ESZ, MSZ, FAULT_NO,  \
                    sve_ld1##PART##_be_host, sve_ld1##PART##_be_tlb);     \
 +}                                                                       \
 +void HELPER(sve_ldff1##PART##_le_r_mte)(CPUARMState *env, void *vg,     \
 +                                        target_ulong addr, uint32_t desc) \
 +{                                                                       \
 +    sve_ldnfff1_r_mte(env, vg, addr, desc, GETPC(), ESZ, MSZ, FAULT_FIRST, \
 +                      sve_ld1##PART##_le_host, sve_ld1##PART##_le_tlb); \
 +}                                                                       \
 +void HELPER(sve_ldnf1##PART##_le_r_mte)(CPUARMState *env, void *vg,     \
 +                                        target_ulong addr, uint32_t desc) \
 +{                                                                       \
 +    sve_ldnfff1_r_mte(env, vg, addr, desc, GETPC(), ESZ, MSZ, FAULT_NO, \
 +                      sve_ld1##PART##_le_host, sve_ld1##PART##_le_tlb); \
 +}                                                                       \
 +void HELPER(sve_ldff1##PART##_be_r_mte)(CPUARMState *env, void *vg,     \
 +                                        target_ulong addr, uint32_t desc) \
 +{                                                                       \
 +    sve_ldnfff1_r_mte(env, vg, addr, desc, GETPC(), ESZ, MSZ, FAULT_FIRST, \
 +                      sve_ld1##PART##_be_host, sve_ld1##PART##_be_tlb); \
 +}                                                                       \
 +void HELPER(sve_ldnf1##PART##_be_r_mte)(CPUARMState *env, void *vg,     \
 +                                        target_ulong addr, uint32_t desc) \
 +{                                                                       \
 +    sve_ldnfff1_r_mte(env, vg, addr, desc, GETPC(), ESZ, MSZ, FAULT_NO, \
 +                      sve_ld1##PART##_be_host, sve_ld1##PART##_be_tlb); \
  }
- DO_LDFF1_LDNF1_1(bb,  MO_8)
+@@ -XXX,XX +XXX,XX @@ static bool trans_FLCMPd(DisasContext *dc, arg_FLCMPd *a)
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
-index XXXXXXX..XXXXXXX 100644
+     src1 = gen_load_fpr_D(dc, a->rs1);
---- a/target/arm/translate-sve.c
+     src2 = gen_load_fpr_D(dc, a->rs2);
-+++ b/target/arm/translate-sve.c
+-    gen_helper_flcmpd(cpu_fcc[a->cc], src1, src2);
-@@ -XXX,XX +XXX,XX @@ static bool trans_LD_zpri(DisasContext *s, arg_rpri_load *a)
++    gen_helper_flcmpd(cpu_fcc[a->cc], tcg_env, src1, src2);
+     return advance_pc(dc);
  static bool trans_LDFF1_zprr(DisasContext *s, arg_rprr_load *a)
  {
 -    static gen_helper_gvec_mem * const fns[2][16] = {
 -        /* Little-endian */
 -        { gen_helper_sve_ldff1bb_r,
 -          gen_helper_sve_ldff1bhu_r,
 -          gen_helper_sve_ldff1bsu_r,
 -          gen_helper_sve_ldff1bdu_r,
 +    static gen_helper_gvec_mem * const fns[2][2][16] = {
 +        { /* mte inactive, little-endian */
 +          { gen_helper_sve_ldff1bb_r,
 +            gen_helper_sve_ldff1bhu_r,
 +            gen_helper_sve_ldff1bsu_r,
 +            gen_helper_sve_ldff1bdu_r,
 -          gen_helper_sve_ldff1sds_le_r,
 -          gen_helper_sve_ldff1hh_le_r,
 -          gen_helper_sve_ldff1hsu_le_r,
 -          gen_helper_sve_ldff1hdu_le_r,
 +            gen_helper_sve_ldff1sds_le_r,
 +            gen_helper_sve_ldff1hh_le_r,
 +            gen_helper_sve_ldff1hsu_le_r,
 +            gen_helper_sve_ldff1hdu_le_r,
 -          gen_helper_sve_ldff1hds_le_r,
 -          gen_helper_sve_ldff1hss_le_r,
 -          gen_helper_sve_ldff1ss_le_r,
 -          gen_helper_sve_ldff1sdu_le_r,
 +            gen_helper_sve_ldff1hds_le_r,
 +            gen_helper_sve_ldff1hss_le_r,
 +            gen_helper_sve_ldff1ss_le_r,
 +            gen_helper_sve_ldff1sdu_le_r,
 -          gen_helper_sve_ldff1bds_r,
 -          gen_helper_sve_ldff1bss_r,
 -          gen_helper_sve_ldff1bhs_r,
 -          gen_helper_sve_ldff1dd_le_r },
 +            gen_helper_sve_ldff1bds_r,
 +            gen_helper_sve_ldff1bss_r,
 +            gen_helper_sve_ldff1bhs_r,
 +            gen_helper_sve_ldff1dd_le_r },
 -        /* Big-endian */
 -        { gen_helper_sve_ldff1bb_r,
 -          gen_helper_sve_ldff1bhu_r,
 -          gen_helper_sve_ldff1bsu_r,
 -          gen_helper_sve_ldff1bdu_r,
 +          /* mte inactive, big-endian */
 +          { gen_helper_sve_ldff1bb_r,
 +            gen_helper_sve_ldff1bhu_r,
 +            gen_helper_sve_ldff1bsu_r,
 +            gen_helper_sve_ldff1bdu_r,
 -          gen_helper_sve_ldff1sds_be_r,
 -          gen_helper_sve_ldff1hh_be_r,
 -          gen_helper_sve_ldff1hsu_be_r,
 -          gen_helper_sve_ldff1hdu_be_r,
 +            gen_helper_sve_ldff1sds_be_r,
 +            gen_helper_sve_ldff1hh_be_r,
 +            gen_helper_sve_ldff1hsu_be_r,
 +            gen_helper_sve_ldff1hdu_be_r,
 -          gen_helper_sve_ldff1hds_be_r,
 -          gen_helper_sve_ldff1hss_be_r,
 -          gen_helper_sve_ldff1ss_be_r,
 -          gen_helper_sve_ldff1sdu_be_r,
 +            gen_helper_sve_ldff1hds_be_r,
 +            gen_helper_sve_ldff1hss_be_r,
 +            gen_helper_sve_ldff1ss_be_r,
 +            gen_helper_sve_ldff1sdu_be_r,
 -          gen_helper_sve_ldff1bds_r,
 -          gen_helper_sve_ldff1bss_r,
 -          gen_helper_sve_ldff1bhs_r,
 -          gen_helper_sve_ldff1dd_be_r },
 +            gen_helper_sve_ldff1bds_r,
 +            gen_helper_sve_ldff1bss_r,
 +            gen_helper_sve_ldff1bhs_r,
 +            gen_helper_sve_ldff1dd_be_r } },
 +
 +        { /* mte active, little-endian */
 +          { gen_helper_sve_ldff1bb_r_mte,
 +            gen_helper_sve_ldff1bhu_r_mte,
 +            gen_helper_sve_ldff1bsu_r_mte,
 +            gen_helper_sve_ldff1bdu_r_mte,
 +
 +            gen_helper_sve_ldff1sds_le_r_mte,
 +            gen_helper_sve_ldff1hh_le_r_mte,
 +            gen_helper_sve_ldff1hsu_le_r_mte,
 +            gen_helper_sve_ldff1hdu_le_r_mte,
 +
 +            gen_helper_sve_ldff1hds_le_r_mte,
 +            gen_helper_sve_ldff1hss_le_r_mte,
 +            gen_helper_sve_ldff1ss_le_r_mte,
 +            gen_helper_sve_ldff1sdu_le_r_mte,
 +
 +            gen_helper_sve_ldff1bds_r_mte,
 +            gen_helper_sve_ldff1bss_r_mte,
 +            gen_helper_sve_ldff1bhs_r_mte,
 +            gen_helper_sve_ldff1dd_le_r_mte },
 +
 +          /* mte active, big-endian */
 +          { gen_helper_sve_ldff1bb_r_mte,
 +            gen_helper_sve_ldff1bhu_r_mte,
 +            gen_helper_sve_ldff1bsu_r_mte,
 +            gen_helper_sve_ldff1bdu_r_mte,
 +
 +            gen_helper_sve_ldff1sds_be_r_mte,
 +            gen_helper_sve_ldff1hh_be_r_mte,
 +            gen_helper_sve_ldff1hsu_be_r_mte,
 +            gen_helper_sve_ldff1hdu_be_r_mte,
 +
 +            gen_helper_sve_ldff1hds_be_r_mte,
 +            gen_helper_sve_ldff1hss_be_r_mte,
 +            gen_helper_sve_ldff1ss_be_r_mte,
 +            gen_helper_sve_ldff1sdu_be_r_mte,
 +
 +            gen_helper_sve_ldff1bds_r_mte,
 +            gen_helper_sve_ldff1bss_r_mte,
 +            gen_helper_sve_ldff1bhs_r_mte,
 +            gen_helper_sve_ldff1dd_be_r_mte } },
      };
      if (sve_access_check(s)) {
          TCGv_i64 addr = new_tmp_a64(s);
          tcg_gen_shli_i64(addr, cpu_reg(s, a->rm), dtype_msz(a->dtype));
          tcg_gen_add_i64(addr, addr, cpu_reg_sp(s, a->rn));
 -        do_mem_zpa(s, a->rd, a->pg, addr, a->dtype, 0, false,
 -                   fns[s->be_data == MO_BE][a->dtype]);
 +        do_mem_zpa(s, a->rd, a->pg, addr, a->dtype, 1, false,
 +                   fns[s->mte_active[0]][s->be_data == MO_BE][a->dtype]);
      }
      return true;
  }
- static bool trans_LDNF1_zpri(DisasContext *s, arg_rpri_load *a)
- {
--    static gen_helper_gvec_mem * const fns[2][16] = {
--        /* Little-endian */
--        { gen_helper_sve_ldnf1bb_r,
--          gen_helper_sve_ldnf1bhu_r,
--          gen_helper_sve_ldnf1bsu_r,
--          gen_helper_sve_ldnf1bdu_r,
-+    static gen_helper_gvec_mem * const fns[2][2][16] = {
-+        { /* mte inactive, little-endian */
-+          { gen_helper_sve_ldnf1bb_r,
-+            gen_helper_sve_ldnf1bhu_r,
-+            gen_helper_sve_ldnf1bsu_r,
-+            gen_helper_sve_ldnf1bdu_r,
--          gen_helper_sve_ldnf1sds_le_r,
--          gen_helper_sve_ldnf1hh_le_r,
--          gen_helper_sve_ldnf1hsu_le_r,
--          gen_helper_sve_ldnf1hdu_le_r,
-+            gen_helper_sve_ldnf1sds_le_r,
-+            gen_helper_sve_ldnf1hh_le_r,
-+            gen_helper_sve_ldnf1hsu_le_r,
-+            gen_helper_sve_ldnf1hdu_le_r,
--          gen_helper_sve_ldnf1hds_le_r,
--          gen_helper_sve_ldnf1hss_le_r,
--          gen_helper_sve_ldnf1ss_le_r,
--          gen_helper_sve_ldnf1sdu_le_r,
-+            gen_helper_sve_ldnf1hds_le_r,
-+            gen_helper_sve_ldnf1hss_le_r,
-+            gen_helper_sve_ldnf1ss_le_r,
-+            gen_helper_sve_ldnf1sdu_le_r,
--          gen_helper_sve_ldnf1bds_r,
--          gen_helper_sve_ldnf1bss_r,
--          gen_helper_sve_ldnf1bhs_r,
--          gen_helper_sve_ldnf1dd_le_r },
-+            gen_helper_sve_ldnf1bds_r,
-+            gen_helper_sve_ldnf1bss_r,
-+            gen_helper_sve_ldnf1bhs_r,
-+            gen_helper_sve_ldnf1dd_le_r },
--        /* Big-endian */
--        { gen_helper_sve_ldnf1bb_r,
--          gen_helper_sve_ldnf1bhu_r,
--          gen_helper_sve_ldnf1bsu_r,
--          gen_helper_sve_ldnf1bdu_r,
-+          /* mte inactive, big-endian */
-+          { gen_helper_sve_ldnf1bb_r,
-+            gen_helper_sve_ldnf1bhu_r,
-+            gen_helper_sve_ldnf1bsu_r,
-+            gen_helper_sve_ldnf1bdu_r,
--          gen_helper_sve_ldnf1sds_be_r,
--          gen_helper_sve_ldnf1hh_be_r,
--          gen_helper_sve_ldnf1hsu_be_r,
--          gen_helper_sve_ldnf1hdu_be_r,
-+            gen_helper_sve_ldnf1sds_be_r,
-+            gen_helper_sve_ldnf1hh_be_r,
-+            gen_helper_sve_ldnf1hsu_be_r,
-+            gen_helper_sve_ldnf1hdu_be_r,
--          gen_helper_sve_ldnf1hds_be_r,
--          gen_helper_sve_ldnf1hss_be_r,
--          gen_helper_sve_ldnf1ss_be_r,
--          gen_helper_sve_ldnf1sdu_be_r,
-+            gen_helper_sve_ldnf1hds_be_r,
-+            gen_helper_sve_ldnf1hss_be_r,
-+            gen_helper_sve_ldnf1ss_be_r,
-+            gen_helper_sve_ldnf1sdu_be_r,
--          gen_helper_sve_ldnf1bds_r,
--          gen_helper_sve_ldnf1bss_r,
--          gen_helper_sve_ldnf1bhs_r,
--          gen_helper_sve_ldnf1dd_be_r },
-+            gen_helper_sve_ldnf1bds_r,
-+            gen_helper_sve_ldnf1bss_r,
-+            gen_helper_sve_ldnf1bhs_r,
-+            gen_helper_sve_ldnf1dd_be_r } },
-+
-+        { /* mte inactive, little-endian */
-+          { gen_helper_sve_ldnf1bb_r_mte,
-+            gen_helper_sve_ldnf1bhu_r_mte,
-+            gen_helper_sve_ldnf1bsu_r_mte,
-+            gen_helper_sve_ldnf1bdu_r_mte,
-+
-+            gen_helper_sve_ldnf1sds_le_r_mte,
-+            gen_helper_sve_ldnf1hh_le_r_mte,
-+            gen_helper_sve_ldnf1hsu_le_r_mte,
-+            gen_helper_sve_ldnf1hdu_le_r_mte,
-+
-+            gen_helper_sve_ldnf1hds_le_r_mte,
-+            gen_helper_sve_ldnf1hss_le_r_mte,
-+            gen_helper_sve_ldnf1ss_le_r_mte,
-+            gen_helper_sve_ldnf1sdu_le_r_mte,
-+
-+            gen_helper_sve_ldnf1bds_r_mte,
-+            gen_helper_sve_ldnf1bss_r_mte,
-+            gen_helper_sve_ldnf1bhs_r_mte,
-+            gen_helper_sve_ldnf1dd_le_r_mte },
-+
-+          /* mte inactive, big-endian */
-+          { gen_helper_sve_ldnf1bb_r_mte,
-+            gen_helper_sve_ldnf1bhu_r_mte,
-+            gen_helper_sve_ldnf1bsu_r_mte,
-+            gen_helper_sve_ldnf1bdu_r_mte,
-+
-+            gen_helper_sve_ldnf1sds_be_r_mte,
-+            gen_helper_sve_ldnf1hh_be_r_mte,
-+            gen_helper_sve_ldnf1hsu_be_r_mte,
-+            gen_helper_sve_ldnf1hdu_be_r_mte,
-+
-+            gen_helper_sve_ldnf1hds_be_r_mte,
-+            gen_helper_sve_ldnf1hss_be_r_mte,
-+            gen_helper_sve_ldnf1ss_be_r_mte,
-+            gen_helper_sve_ldnf1sdu_be_r_mte,
-+
-+            gen_helper_sve_ldnf1bds_r_mte,
-+            gen_helper_sve_ldnf1bss_r_mte,
-+            gen_helper_sve_ldnf1bhs_r_mte,
-+            gen_helper_sve_ldnf1dd_be_r_mte } },
-     };
-     if (sve_access_check(s)) {
-@@ -XXX,XX +XXX,XX @@ static bool trans_LDNF1_zpri(DisasContext *s, arg_rpri_load *a)
-         TCGv_i64 addr = new_tmp_a64(s);
-         tcg_gen_addi_i64(addr, cpu_reg_sp(s, a->rn), off);
--        do_mem_zpa(s, a->rd, a->pg, addr, a->dtype, 0, false,
--                   fns[s->be_data == MO_BE][a->dtype]);
-+        do_mem_zpa(s, a->rd, a->pg, addr, a->dtype, 1, false,
-+                   fns[s->mte_active[0]][s->be_data == MO_BE][a->dtype]);
-     }
-     return true;
- }
 --
-.20.1
+.34.1

-New patch
+[PULL 38/72] target/ppc: Use env->fp_status in helper_compute_fprf functions
+In the helper_compute_fprf functions, we pass a dummy float_status
+in to the is_signaling_nan() function. This is unnecessary, because
+we have convenient access to the CPU env pointer here and that
+is already set up with the correct values for the snan_bit_is_one
+and no_signaling_nans config settings. is_signaling_nan() doesn't
+ever update the fp_status with any exception flags, so there is
+no reason not to use env->fp_status here.
+Use env->fp_status instead of the dummy fp_status.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-34-peter.maydell@linaro.org
+---
+ target/ppc/fpu_helper.c | 3 +--
+file changed, 1 insertion(+), 2 deletions(-)
+diff --git a/target/ppc/fpu_helper.c b/target/ppc/fpu_helper.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/ppc/fpu_helper.c
++++ b/target/ppc/fpu_helper.c
+@@ -XXX,XX +XXX,XX @@ void helper_compute_fprf_##tp(CPUPPCState *env, tp arg)           \
+     } else if (tp##_is_infinity(arg)) {                           \
+         fprf = neg ? 0x09 << FPSCR_FPRF : 0x05 << FPSCR_FPRF;     \
+     } else {                                                      \
+-        float_status dummy = { };  /* snan_bit_is_one = 0 */      \
+-        if (tp##_is_signaling_nan(arg, &dummy)) {                 \
++        if (tp##_is_signaling_nan(arg, &env->fp_status)) {        \
+             fprf = 0x00 << FPSCR_FPRF;                            \
+         } else {                                                  \
+             fprf = 0x11 << FPSCR_FPRF;                            \
+--
+.34.1

-[PULL 44/57] target/arm: Add arm_tlb_bti_gp
+[PULL 39/72] target/arm: Copy entire float_status in is_ebf
 From: Richard Henderson <richard.henderson@linaro.org>
-Introduce an lvalue macro to wrap target_tlb_bit0.
+Now that float_status has a bunch of fp parameters,
 it is easier to copy an existing structure than create
 one from scratch.  Begin by copying the structure that
 corresponds to the FPSR and make only the adjustments
 required for BFloat16 semantics.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Philippe Mathieu-Daudé <philmd@linaro.org>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241203203949.483774-2-richard.henderson@linaro.org
 Message-id: 20200626033144.790098-33-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/cpu.h           | 13 +++++++++++++
+ target/arm/tcg/vec_helper.c | 20 +++++++-------------
- target/arm/helper.c        |  2 +-
+file changed, 7 insertions(+), 13 deletions(-)
  target/arm/translate-a64.c |  2 +-
 files changed, 15 insertions(+), 2 deletions(-)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
+diff --git a/target/arm/tcg/vec_helper.c b/target/arm/tcg/vec_helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/target/arm/tcg/vec_helper.c
-+++ b/target/arm/cpu.h
++++ b/target/arm/tcg/vec_helper.c
-@@ -XXX,XX +XXX,XX @@ static inline uint64_t *aa64_vfp_qreg(CPUARMState *env, unsigned regno)
+@@ -XXX,XX +XXX,XX @@ bool is_ebf(CPUARMState *env, float_status *statusp, float_status *oddstatusp)
- /* Shared between translate-sve.c and sve_helper.c.  */
+      * no effect on AArch32 instructions.
- extern const uint64_t pred_esz_masks[4];
+      */
+     bool ebf = is_a64(env) && env->vfp.fpcr & FPCR_EBF;
-+/* Helper for the macros below, validating the argument type. */
+-    *statusp = (float_status){
-+static inline MemTxAttrs *typecheck_memtxattrs(MemTxAttrs *x)
+-        .tininess_before_rounding = float_tininess_before_rounding,
-+{
+-        .float_rounding_mode = float_round_to_odd_inf,
-+    return x;
+-        .flush_to_zero = true,
-+}
+-        .flush_inputs_to_zero = true,
 -        .default_nan_mode = true,
 -    };
 +
-+/*
++    *statusp = env->vfp.fp_status;
-+ * Lvalue macros for ARM TLB bits that we must cache in the TCG TLB.
++    set_default_nan_mode(true, statusp);
-+ * Using these should be a bit more self-documenting than using the
-+ * generic target bits directly.
+     if (ebf) {
-+ */
+-        float_status *fpst = &env->vfp.fp_status;
-+#define arm_tlb_bti_gp(x) (typecheck_memtxattrs(x)->target_tlb_bit0)
+-        set_flush_to_zero(get_flush_to_zero(fpst), statusp);
-+
+-        set_flush_inputs_to_zero(get_flush_inputs_to_zero(fpst), statusp);
- /*
+-        set_float_rounding_mode(get_float_rounding_mode(fpst), statusp);
-  * Naming convention for isar_feature functions:
+-
-  * Functions which test 32-bit ID registers should have _aa32_ in
+         /* EBF=1 needs to do a step with round-to-odd semantics */
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+         *oddstatusp = *statusp;
-index XXXXXXX..XXXXXXX 100644
+         set_float_rounding_mode(float_round_to_odd, oddstatusp);
---- a/target/arm/helper.c
++    } else {
-+++ b/target/arm/helper.c
++        set_flush_to_zero(true, statusp);
-@@ -XXX,XX +XXX,XX @@ static bool get_phys_addr_lpae(CPUARMState *env, target_ulong address,
++        set_flush_inputs_to_zero(true, statusp);
 +        set_float_rounding_mode(float_round_to_odd_inf, statusp);
      }
-     /* When in aarch64 mode, and BTI is enabled, remember GP in the IOTLB.  */
+-
-     if (aarch64 && guarded && cpu_isar_feature(aa64_bti, cpu)) {
+     return ebf;
 -        txattrs->target_tlb_bit0 = true;
 +        arm_tlb_bti_gp(txattrs) = true;
      }
      if (cacheattrs != NULL) {
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static bool is_guarded_page(CPUARMState *env, DisasContext *s)
       * table entry even for that case.
       */
      return (tlb_hit(entry->addr_code, addr) &&
 -            env_tlb(env)->d[mmu_idx].iotlb[index].attrs.target_tlb_bit0);
 +            arm_tlb_bti_gp(&env_tlb(env)->d[mmu_idx].iotlb[index].attrs));
  #endif
  }
 --
-.20.1
+.34.1

-[PULL 27/57] target/arm: Implement LDG, STG, ST2G instructions
+[PULL 40/72] fpu: Allow runtime choice of default NaN value
-From: Richard Henderson <richard.henderson@linaro.org>
+Currently we hardcode the default NaN value in parts64_default_nan()
 using a compile-time ifdef ladder. This is awkward for two cases:
  * for single-QEMU-binary we can't hard-code target-specifics like this
  * for Arm FEAT_AFP the default NaN value depends on FPCR.AH
    (specifically the sign bit is different)
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Add a field to float_status to specify the default NaN value; fall
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+back to the old ifdef behaviour if these are not set.
-Message-id: 20200626033144.790098-16-richard.henderson@linaro.org
 The default NaN value is specified by setting a uint8_t to a
 pattern corresponding to the sign and upper fraction parts of
 the NaN; the lower bits of the fraction are set from bit 0 of
 the pattern.
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-35-peter.maydell@linaro.org
 ---
- target/arm/helper-a64.h    |   7 ++
+ include/fpu/softfloat-helpers.h | 11 +++++++
- target/arm/helper.h        |   2 +
+ include/fpu/softfloat-types.h   | 10 ++++++
- target/arm/mte_helper.c    | 194 +++++++++++++++++++++++++++++++++++++
+ fpu/softfloat-specialize.c.inc  | 55 ++++++++++++++++++++-------------
- target/arm/op_helper.c     |  16 +++
+files changed, 54 insertions(+), 22 deletions(-)
  target/arm/translate-a64.c | 172 +++++++++++++++++++++++++++++++-
 files changed, 386 insertions(+), 5 deletions(-)
-diff --git a/target/arm/helper-a64.h b/target/arm/helper-a64.h
+diff --git a/include/fpu/softfloat-helpers.h b/include/fpu/softfloat-helpers.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-a64.h
+--- a/include/fpu/softfloat-helpers.h
-+++ b/target/arm/helper-a64.h
++++ b/include/fpu/softfloat-helpers.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_2(xpacd, TCG_CALL_NO_RWG_SE, i64, env, i64)
+@@ -XXX,XX +XXX,XX @@ static inline void set_float_infzeronan_rule(FloatInfZeroNaNRule rule,
+     status->float_infzeronan_rule = rule;
  DEF_HELPER_FLAGS_3(irg, TCG_CALL_NO_RWG, i64, env, i64, i64)
  DEF_HELPER_FLAGS_4(addsubg, TCG_CALL_NO_RWG_SE, i64, env, i64, s32, i32)
 +DEF_HELPER_FLAGS_3(ldg, TCG_CALL_NO_WG, i64, env, i64, i64)
 +DEF_HELPER_FLAGS_3(stg, TCG_CALL_NO_WG, void, env, i64, i64)
 +DEF_HELPER_FLAGS_3(stg_parallel, TCG_CALL_NO_WG, void, env, i64, i64)
 +DEF_HELPER_FLAGS_2(stg_stub, TCG_CALL_NO_WG, void, env, i64)
 +DEF_HELPER_FLAGS_3(st2g, TCG_CALL_NO_WG, void, env, i64, i64)
 +DEF_HELPER_FLAGS_3(st2g_parallel, TCG_CALL_NO_WG, void, env, i64, i64)
 +DEF_HELPER_FLAGS_2(st2g_stub, TCG_CALL_NO_WG, void, env, i64)
 diff --git a/target/arm/helper.h b/target/arm/helper.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.h
 +++ b/target/arm/helper.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_1(rebuild_hflags_a32_newel, TCG_CALL_NO_RWG, void, env)
  DEF_HELPER_FLAGS_2(rebuild_hflags_a32, TCG_CALL_NO_RWG, void, env, int)
  DEF_HELPER_FLAGS_2(rebuild_hflags_a64, TCG_CALL_NO_RWG, void, env, int)
 +DEF_HELPER_FLAGS_5(probe_access, TCG_CALL_NO_WG, void, env, tl, i32, i32, i32)
 +
  DEF_HELPER_1(vfp_get_fpscr, i32, env)
  DEF_HELPER_2(vfp_set_fpscr, void, env, i32)
 diff --git a/target/arm/mte_helper.c b/target/arm/mte_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/mte_helper.c
 +++ b/target/arm/mte_helper.c
@@ -XXX,XX +XXX,XX @@ static int choose_nonexcluded_tag(int tag, int offset, uint16_t exclude)
      return tag;
  }
-+/**
++static inline void set_float_default_nan_pattern(uint8_t dnan_pattern,
-+ * allocation_tag_mem:
++                                                 float_status *status)
 + * @env: the cpu environment
 + * @ptr_mmu_idx: the addressing regime to use for the virtual address
 + * @ptr: the virtual address for which to look up tag memory
 + * @ptr_access: the access to use for the virtual address
 + * @ptr_size: the number of bytes in the normal memory access
 + * @tag_access: the access to use for the tag memory
 + * @tag_size: the number of bytes in the tag memory access
 + * @ra: the return address for exception handling
 + *
 + * Our tag memory is formatted as a sequence of little-endian nibbles.
 + * That is, the byte at (addr >> (LOG2_TAG_GRANULE + 1)) contains two
 + * tags, with the tag at [3:0] for the lower addr and the tag at [7:4]
 + * for the higher addr.
 + *
 + * Here, resolve the physical address from the virtual address, and return
 + * a pointer to the corresponding tag byte.  Exit with exception if the
 + * virtual address is not accessible for @ptr_access.
 + *
 + * The @ptr_size and @tag_size values may not have an obvious relation
 + * due to the alignment of @ptr, and the number of tag checks required.
 + *
 + * If there is no tag storage corresponding to @ptr, return NULL.
 + */
 +static uint8_t *allocation_tag_mem(CPUARMState *env, int ptr_mmu_idx,
 +                                   uint64_t ptr, MMUAccessType ptr_access,
 +                                   int ptr_size, MMUAccessType tag_access,
 +                                   int tag_size, uintptr_t ra)
 +{
-+    /* Tag storage not implemented.  */
++    status->default_nan_pattern = dnan_pattern;
 +    return NULL;
 +}
 +
- uint64_t HELPER(irg)(CPUARMState *env, uint64_t rn, uint64_t rm)
+ static inline void set_flush_to_zero(bool val, float_status *status)
  {
-     int rtag;
+     status->flush_to_zero = val;
-@@ -XXX,XX +XXX,XX @@ uint64_t HELPER(addsubg)(CPUARMState *env, uint64_t ptr,
+@@ -XXX,XX +XXX,XX @@ static inline FloatInfZeroNaNRule get_float_infzeronan_rule(float_status *status
+     return status->float_infzeronan_rule;
      return address_with_allocation_tag(ptr + offset, rtag);
  }
-+
-+static int load_tag1(uint64_t ptr, uint8_t *mem)
++static inline uint8_t get_float_default_nan_pattern(float_status *status)
 +{
-+    int ofs = extract32(ptr, LOG2_TAG_GRANULE, 1) * 4;
++    return status->default_nan_pattern;
 +    return extract32(*mem, ofs, 4);
 +}
 +
-+uint64_t HELPER(ldg)(CPUARMState *env, uint64_t ptr, uint64_t xt)
+ static inline bool get_flush_to_zero(float_status *status)
-+{
+ {
-+    int mmu_idx = cpu_mmu_index(env, false);
+     return status->flush_to_zero;
-+    uint8_t *mem;
+diff --git a/include/fpu/softfloat-types.h b/include/fpu/softfloat-types.h
-+    int rtag = 0;
+index XXXXXXX..XXXXXXX 100644
 --- a/include/fpu/softfloat-types.h
 +++ b/include/fpu/softfloat-types.h
@@ -XXX,XX +XXX,XX @@ typedef struct float_status {
      /* should denormalised inputs go to zero and set the input_denormal flag? */
      bool flush_inputs_to_zero;
      bool default_nan_mode;
 +    /*
 +     * The pattern to use for the default NaN. Here the high bit specifies
 +     * the default NaN's sign bit, and bits 6..0 specify the high bits of the
 +     * fractional part. The low bits of the fractional part are copies of bit 0.
 +     * The exponent of the default NaN is (as for any NaN) always all 1s.
 +     * Note that a value of 0 here is not a valid NaN. The target must set
 +     * this to the correct non-zero value, or we will assert when trying to
 +     * create a default NaN.
 +     */
 +    uint8_t default_nan_pattern;
      /*
       * The flags below are not used on all specializations and may
       * constant fold away (see snan_bit_is_one()/no_signalling_nans() in
 diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 index XXXXXXX..XXXXXXX 100644
 --- a/fpu/softfloat-specialize.c.inc
 +++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static void parts64_default_nan(FloatParts64 *p, float_status *status)
  {
      bool sign = 0;
      uint64_t frac;
 +    uint8_t dnan_pattern = status->default_nan_pattern;
 +    if (dnan_pattern == 0) {
  #if defined(TARGET_SPARC) || defined(TARGET_M68K)
 -    /* !snan_bit_is_one, set all bits */
 -    frac = (1ULL << DECOMPOSED_BINARY_POINT) - 1;
 -#elif defined(TARGET_I386) || defined(TARGET_X86_64) \
 +        /* Sign bit clear, all frac bits set */
 +        dnan_pattern = 0b01111111;
 +#elif defined(TARGET_I386) || defined(TARGET_X86_64)    \
      || defined(TARGET_MICROBLAZE)
 -    /* !snan_bit_is_one, set sign and msb */
 -    frac = 1ULL << (DECOMPOSED_BINARY_POINT - 1);
 -    sign = 1;
 +        /* Sign bit set, most significant frac bit set */
 +        dnan_pattern = 0b11000000;
  #elif defined(TARGET_HPPA)
 -    /* snan_bit_is_one, set msb-1.  */
 -    frac = 1ULL << (DECOMPOSED_BINARY_POINT - 2);
 +        /* Sign bit clear, msb-1 frac bit set */
 +        dnan_pattern = 0b00100000;
  #elif defined(TARGET_HEXAGON)
 -    sign = 1;
 -    frac = ~0ULL;
 +        /* Sign bit set, all frac bits set. */
 +        dnan_pattern = 0b11111111;
  #else
 -    /*
 -     * This case is true for Alpha, ARM, MIPS, OpenRISC, PPC, RISC-V,
 -     * S390, SH4, TriCore, and Xtensa.  Our other supported targets
 -     * do not have floating-point.
 -     */
 -    if (snan_bit_is_one(status)) {
 -        /* set all bits other than msb */
 -        frac = (1ULL << (DECOMPOSED_BINARY_POINT - 1)) - 1;
 -    } else {
 -        /* set msb */
 -        frac = 1ULL << (DECOMPOSED_BINARY_POINT - 1);
 -    }
 +        /*
 +         * This case is true for Alpha, ARM, MIPS, OpenRISC, PPC, RISC-V,
 +         * S390, SH4, TriCore, and Xtensa.  Our other supported targets
 +         * do not have floating-point.
 +         */
 +        if (snan_bit_is_one(status)) {
 +            /* sign bit clear, set all frac bits other than msb */
 +            dnan_pattern = 0b00111111;
 +        } else {
 +            /* sign bit clear, set frac msb */
 +            dnan_pattern = 0b01000000;
 +        }
  #endif
 +    }
 +    assert(dnan_pattern != 0);
 +
-+    /* Trap if accessing an invalid page.  */
++    sign = dnan_pattern >> 7;
 +    mem = allocation_tag_mem(env, mmu_idx, ptr, MMU_DATA_LOAD, 1,
 +                             MMU_DATA_LOAD, 1, GETPC());
 +
 +    /* Load if page supports tags. */
 +    if (mem) {
 +        rtag = load_tag1(ptr, mem);
 +    }
 +
 +    return address_with_allocation_tag(xt, rtag);
 +}
 +
 +static void check_tag_aligned(CPUARMState *env, uint64_t ptr, uintptr_t ra)
 +{
 +    if (unlikely(!QEMU_IS_ALIGNED(ptr, TAG_GRANULE))) {
 +        arm_cpu_do_unaligned_access(env_cpu(env), ptr, MMU_DATA_STORE,
 +                                    cpu_mmu_index(env, false), ra);
 +        g_assert_not_reached();
 +    }
 +}
 +
 +/* For use in a non-parallel context, store to the given nibble.  */
 +static void store_tag1(uint64_t ptr, uint8_t *mem, int tag)
 +{
 +    int ofs = extract32(ptr, LOG2_TAG_GRANULE, 1) * 4;
 +    *mem = deposit32(*mem, ofs, 4, tag);
 +}
 +
 +/* For use in a parallel context, atomically store to the given nibble.  */
 +static void store_tag1_parallel(uint64_t ptr, uint8_t *mem, int tag)
 +{
 +    int ofs = extract32(ptr, LOG2_TAG_GRANULE, 1) * 4;
 +    uint8_t old = atomic_read(mem);
 +
 +    while (1) {
 +        uint8_t new = deposit32(old, ofs, 4, tag);
 +        uint8_t cmp = atomic_cmpxchg(mem, old, new);
 +        if (likely(cmp == old)) {
 +            return;
 +        }
 +        old = cmp;
 +    }
 +}
 +
 +typedef void stg_store1(uint64_t, uint8_t *, int);
 +
 +static inline void do_stg(CPUARMState *env, uint64_t ptr, uint64_t xt,
 +                          uintptr_t ra, stg_store1 store1)
 +{
 +    int mmu_idx = cpu_mmu_index(env, false);
 +    uint8_t *mem;
 +
 +    check_tag_aligned(env, ptr, ra);
 +
 +    /* Trap if accessing an invalid page.  */
 +    mem = allocation_tag_mem(env, mmu_idx, ptr, MMU_DATA_STORE, TAG_GRANULE,
 +                             MMU_DATA_STORE, 1, ra);
 +
 +    /* Store if page supports tags. */
 +    if (mem) {
 +        store1(ptr, mem, allocation_tag_from_addr(xt));
 +    }
 +}
 +
 +void HELPER(stg)(CPUARMState *env, uint64_t ptr, uint64_t xt)
 +{
 +    do_stg(env, ptr, xt, GETPC(), store_tag1);
 +}
 +
 +void HELPER(stg_parallel)(CPUARMState *env, uint64_t ptr, uint64_t xt)
 +{
 +    do_stg(env, ptr, xt, GETPC(), store_tag1_parallel);
 +}
 +
 +void HELPER(stg_stub)(CPUARMState *env, uint64_t ptr)
 +{
 +    int mmu_idx = cpu_mmu_index(env, false);
 +    uintptr_t ra = GETPC();
 +
 +    check_tag_aligned(env, ptr, ra);
 +    probe_write(env, ptr, TAG_GRANULE, mmu_idx, ra);
 +}
 +
 +static inline void do_st2g(CPUARMState *env, uint64_t ptr, uint64_t xt,
 +                           uintptr_t ra, stg_store1 store1)
 +{
 +    int mmu_idx = cpu_mmu_index(env, false);
 +    int tag = allocation_tag_from_addr(xt);
 +    uint8_t *mem1, *mem2;
 +
 +    check_tag_aligned(env, ptr, ra);
 +
 +    /*
-+     * Trap if accessing an invalid page(s).
++     * Place default_nan_pattern [6:0] into bits [62:56],
-+     * This takes priority over !allocation_tag_access_enabled.
++     * and replecate bit [0] down into [55:0]
 +     */
-+    if (ptr & TAG_GRANULE) {
++    frac = deposit64(0, DECOMPOSED_BINARY_POINT - 7, 7, dnan_pattern);
-+        /* Two stores unaligned mod TAG_GRANULE*2 -- modify two bytes. */
++    frac = deposit64(frac, 0, DECOMPOSED_BINARY_POINT - 7, -(dnan_pattern & 1));
-+        mem1 = allocation_tag_mem(env, mmu_idx, ptr, MMU_DATA_STORE,
-+                                  TAG_GRANULE, MMU_DATA_STORE, 1, ra);
+     *p = (FloatParts64) {
-+        mem2 = allocation_tag_mem(env, mmu_idx, ptr + TAG_GRANULE,
+         .cls = float_class_qnan,
 +                                  MMU_DATA_STORE, TAG_GRANULE,
 +                                  MMU_DATA_STORE, 1, ra);
 +
 +        /* Store if page(s) support tags. */
 +        if (mem1) {
 +            store1(TAG_GRANULE, mem1, tag);
 +        }
 +        if (mem2) {
 +            store1(0, mem2, tag);
 +        }
 +    } else {
 +        /* Two stores aligned mod TAG_GRANULE*2 -- modify one byte. */
 +        mem1 = allocation_tag_mem(env, mmu_idx, ptr, MMU_DATA_STORE,
 +                                  2 * TAG_GRANULE, MMU_DATA_STORE, 1, ra);
 +        if (mem1) {
 +            tag |= tag << 4;
 +            atomic_set(mem1, tag);
 +        }
 +    }
 +}
 +
 +void HELPER(st2g)(CPUARMState *env, uint64_t ptr, uint64_t xt)
 +{
 +    do_st2g(env, ptr, xt, GETPC(), store_tag1);
 +}
 +
 +void HELPER(st2g_parallel)(CPUARMState *env, uint64_t ptr, uint64_t xt)
 +{
 +    do_st2g(env, ptr, xt, GETPC(), store_tag1_parallel);
 +}
 +
 +void HELPER(st2g_stub)(CPUARMState *env, uint64_t ptr)
 +{
 +    int mmu_idx = cpu_mmu_index(env, false);
 +    uintptr_t ra = GETPC();
 +    int in_page = -(ptr | TARGET_PAGE_MASK);
 +
 +    check_tag_aligned(env, ptr, ra);
 +
 +    if (likely(in_page >= 2 * TAG_GRANULE)) {
 +        probe_write(env, ptr, 2 * TAG_GRANULE, mmu_idx, ra);
 +    } else {
 +        probe_write(env, ptr, TAG_GRANULE, mmu_idx, ra);
 +        probe_write(env, ptr + TAG_GRANULE, TAG_GRANULE, mmu_idx, ra);
 +    }
 +}
 diff --git a/target/arm/op_helper.c b/target/arm/op_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/op_helper.c
 +++ b/target/arm/op_helper.c
@@ -XXX,XX +XXX,XX @@ uint32_t HELPER(ror_cc)(CPUARMState *env, uint32_t x, uint32_t i)
          return ((uint32_t)x >> shift) | (x << (32 - shift));
      }
  }
 +
 +void HELPER(probe_access)(CPUARMState *env, target_ulong ptr,
 +                          uint32_t access_type, uint32_t mmu_idx,
 +                          uint32_t size)
 +{
 +    uint32_t in_page = -((uint32_t)ptr | TARGET_PAGE_SIZE);
 +    uintptr_t ra = GETPC();
 +
 +    if (likely(size <= in_page)) {
 +        probe_access(env, ptr, size, access_type, mmu_idx, ra);
 +    } else {
 +        probe_access(env, ptr, in_page, access_type, mmu_idx, ra);
 +        probe_access(env, ptr + in_page, size - in_page,
 +                     access_type, mmu_idx, ra);
 +    }
 +}
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void gen_address_with_allocation_tag0(TCGv_i64 dst, TCGv_i64 src)
      tcg_gen_andi_i64(dst, src, ~MAKE_64BIT_MASK(56, 4));
  }
 +static void gen_probe_access(DisasContext *s, TCGv_i64 ptr,
 +                             MMUAccessType acc, int log2_size)
 +{
 +    TCGv_i32 t_acc = tcg_const_i32(acc);
 +    TCGv_i32 t_idx = tcg_const_i32(get_mem_index(s));
 +    TCGv_i32 t_size = tcg_const_i32(1 << log2_size);
 +
 +    gen_helper_probe_access(cpu_env, ptr, t_acc, t_idx, t_size);
 +    tcg_temp_free_i32(t_acc);
 +    tcg_temp_free_i32(t_idx);
 +    tcg_temp_free_i32(t_size);
 +}
 +
  typedef struct DisasCompare64 {
      TCGCond cond;
      TCGv_i64 value;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
      }
  }
 +/*
 + * Load/Store memory tags
 + *
 + *  31 30 29         24     22  21     12    10      5      0
 + * +-----+-------------+-----+---+------+-----+------+------+
 + * | 1 1 | 0 1 1 0 0 1 | op1 | 1 | imm9 | op2 |  Rn  |  Rt  |
 + * +-----+-------------+-----+---+------+-----+------+------+
 + */
 +static void disas_ldst_tag(DisasContext *s, uint32_t insn)
 +{
 +    int rt = extract32(insn, 0, 5);
 +    int rn = extract32(insn, 5, 5);
 +    uint64_t offset = sextract64(insn, 12, 9) << LOG2_TAG_GRANULE;
 +    int op2 = extract32(insn, 10, 2);
 +    int op1 = extract32(insn, 22, 2);
 +    bool is_load = false, is_pair = false, is_zero = false;
 +    int index = 0;
 +    TCGv_i64 addr, clean_addr, tcg_rt;
 +
 +    /* We checked insn bits [29:24,21] in the caller.  */
 +    if (extract32(insn, 30, 2) != 3) {
 +        goto do_unallocated;
 +    }
 +
 +    /*
 +     * @index is a tri-state variable which has 3 states:
 +     * < 0 : post-index, writeback
 +     * = 0 : signed offset
 +     * > 0 : pre-index, writeback
 +     */
 +    switch (op1) {
 +    case 0:
 +        if (op2 != 0) {
 +            /* STG */
 +            index = op2 - 2;
 +            break;
 +        }
 +        goto do_unallocated;
 +    case 1:
 +        if (op2 != 0) {
 +            /* STZG */
 +            is_zero = true;
 +            index = op2 - 2;
 +        } else {
 +            /* LDG */
 +            is_load = true;
 +        }
 +        break;
 +    case 2:
 +        if (op2 != 0) {
 +            /* ST2G */
 +            is_pair = true;
 +            index = op2 - 2;
 +            break;
 +        }
 +        goto do_unallocated;
 +    case 3:
 +        if (op2 != 0) {
 +            /* STZ2G */
 +            is_pair = is_zero = true;
 +            index = op2 - 2;
 +            break;
 +        }
 +        goto do_unallocated;
 +
 +    default:
 +    do_unallocated:
 +        unallocated_encoding(s);
 +        return;
 +    }
 +
 +    if (!dc_isar_feature(aa64_mte_insn_reg, s)) {
 +        goto do_unallocated;
 +    }
 +
 +    if (rn == 31) {
 +        gen_check_sp_alignment(s);
 +    }
 +
 +    addr = read_cpu_reg_sp(s, rn, true);
 +    if (index >= 0) {
 +        /* pre-index or signed offset */
 +        tcg_gen_addi_i64(addr, addr, offset);
 +    }
 +
 +    if (is_load) {
 +        tcg_gen_andi_i64(addr, addr, -TAG_GRANULE);
 +        tcg_rt = cpu_reg(s, rt);
 +        if (s->ata) {
 +            gen_helper_ldg(tcg_rt, cpu_env, addr, tcg_rt);
 +        } else {
 +            clean_addr = clean_data_tbi(s, addr);
 +            gen_probe_access(s, clean_addr, MMU_DATA_LOAD, MO_8);
 +            gen_address_with_allocation_tag0(tcg_rt, addr);
 +        }
 +    } else {
 +        tcg_rt = cpu_reg_sp(s, rt);
 +        if (!s->ata) {
 +            /*
 +             * For STG and ST2G, we need to check alignment and probe memory.
 +             * TODO: For STZG and STZ2G, we could rely on the stores below,
 +             * at least for system mode; user-only won't enforce alignment.
 +             */
 +            if (is_pair) {
 +                gen_helper_st2g_stub(cpu_env, addr);
 +            } else {
 +                gen_helper_stg_stub(cpu_env, addr);
 +            }
 +        } else if (tb_cflags(s->base.tb) & CF_PARALLEL) {
 +            if (is_pair) {
 +                gen_helper_st2g_parallel(cpu_env, addr, tcg_rt);
 +            } else {
 +                gen_helper_stg_parallel(cpu_env, addr, tcg_rt);
 +            }
 +        } else {
 +            if (is_pair) {
 +                gen_helper_st2g(cpu_env, addr, tcg_rt);
 +            } else {
 +                gen_helper_stg(cpu_env, addr, tcg_rt);
 +            }
 +        }
 +    }
 +
 +    if (is_zero) {
 +        TCGv_i64 clean_addr = clean_data_tbi(s, addr);
 +        TCGv_i64 tcg_zero = tcg_const_i64(0);
 +        int mem_index = get_mem_index(s);
 +        int i, n = (1 + is_pair) << LOG2_TAG_GRANULE;
 +
 +        tcg_gen_qemu_st_i64(tcg_zero, clean_addr, mem_index,
 +                            MO_Q | MO_ALIGN_16);
 +        for (i = 8; i < n; i += 8) {
 +            tcg_gen_addi_i64(clean_addr, clean_addr, 8);
 +            tcg_gen_qemu_st_i64(tcg_zero, clean_addr, mem_index, MO_Q);
 +        }
 +        tcg_temp_free_i64(tcg_zero);
 +    }
 +
 +    if (index != 0) {
 +        /* pre-index or post-index */
 +        if (index < 0) {
 +            /* post-index */
 +            tcg_gen_addi_i64(addr, addr, offset);
 +        }
 +        tcg_gen_mov_i64(cpu_reg_sp(s, rn), addr);
 +    }
 +}
 +
  /* Loads and stores */
  static void disas_ldst(DisasContext *s, uint32_t insn)
  {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst(DisasContext *s, uint32_t insn)
      case 0x0d: /* AdvSIMD load/store single structure */
          disas_ldst_single_struct(s, insn);
          break;
 -    case 0x19: /* LDAPR/STLR (unscaled immediate) */
 -        if (extract32(insn, 10, 2) != 0 ||
 -            extract32(insn, 21, 1) != 0) {
 +    case 0x19:
 +        if (extract32(insn, 21, 1) != 0) {
 +            disas_ldst_tag(s, insn);
 +        } else if (extract32(insn, 10, 2) == 0) {
 +            disas_ldst_ldapr_stlr(s, insn);
 +        } else {
              unallocated_encoding(s);
 -            break;
          }
 -        disas_ldst_ldapr_stlr(s, insn);
          break;
      default:
          unallocated_encoding(s);
 --
-.20.1
+.34.1

-[PULL 06/57] hw/misc/pca9552: Rename generic code as pca955x
+[PULL 41/72] tests/fp: Set default NaN pattern explicitly
-From: Philippe Mathieu-Daudé <f4bug@amsat.org>
+Set the default NaN pattern explicitly for the tests/fp code.
-Various code from the PCA9552 device model is generic to the
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-PCA955X family. We'll split the generic code in a base class
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-in the next commit. To ease review, first do a dumb renaming.
+Message-id: 20241202131347.498124-36-peter.maydell@linaro.org
 ---
  tests/fp/fp-bench.c     | 1 +
  tests/fp/fp-test-log2.c | 1 +
  tests/fp/fp-test.c      | 1 +
 files changed, 3 insertions(+)
-Reviewed-by: Cédric Le Goater <clg@kaod.org>
+diff --git a/tests/fp/fp-bench.c b/tests/fp/fp-bench.c
 Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
 Tested-by: Cédric Le Goater <clg@kaod.org>
 Message-id: 20200623072723.6324-4-f4bug@amsat.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  include/hw/misc/pca9552.h | 10 ++---
  hw/misc/pca9552.c         | 80 +++++++++++++++++++--------------------
 files changed, 45 insertions(+), 45 deletions(-)
 diff --git a/include/hw/misc/pca9552.h b/include/hw/misc/pca9552.h
 index XXXXXXX..XXXXXXX 100644
---- a/include/hw/misc/pca9552.h
+--- a/tests/fp/fp-bench.c
-+++ b/include/hw/misc/pca9552.h
++++ b/tests/fp/fp-bench.c
-@@ -XXX,XX +XXX,XX @@
+@@ -XXX,XX +XXX,XX @@ static void run_bench(void)
- #include "hw/i2c/i2c.h"
+     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &soft_status);
+     set_float_3nan_prop_rule(float_3nan_prop_s_cab, &soft_status);
- #define TYPE_PCA9552 "pca9552"
+     set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, &soft_status);
--#define PCA9552(obj) OBJECT_CHECK(PCA9552State, (obj), TYPE_PCA9552)
++    set_float_default_nan_pattern(0b01000000, &soft_status);
-+#define PCA955X(obj) OBJECT_CHECK(PCA955xState, (obj), TYPE_PCA9552)
+     f = bench_funcs[operation][precision];
--#define PCA9552_NR_REGS 10
+     g_assert(f);
-+#define PCA955X_NR_REGS 10
+diff --git a/tests/fp/fp-test-log2.c b/tests/fp/fp-test-log2.c
 -typedef struct PCA9552State {
 +typedef struct PCA955xState {
      /*< private >*/
      I2CSlave i2c;
      /*< public >*/
@@ -XXX,XX +XXX,XX @@ typedef struct PCA9552State {
      uint8_t len;
      uint8_t pointer;
 -    uint8_t regs[PCA9552_NR_REGS];
 +    uint8_t regs[PCA955X_NR_REGS];
      uint8_t max_reg;
      uint8_t pin_count;
 -} PCA9552State;
 +} PCA955xState;
  #endif
 diff --git a/hw/misc/pca9552.c b/hw/misc/pca9552.c
 index XXXXXXX..XXXXXXX 100644
---- a/hw/misc/pca9552.c
+--- a/tests/fp/fp-test-log2.c
-+++ b/hw/misc/pca9552.c
++++ b/tests/fp/fp-test-log2.c
-@@ -XXX,XX +XXX,XX @@
+@@ -XXX,XX +XXX,XX @@ int main(int ac, char **av)
  static const char *led_state[] = {"on", "off", "pwm0", "pwm1"};
 -static uint8_t pca9552_pin_get_config(PCA9552State *s, int pin)
 +static uint8_t pca955x_pin_get_config(PCA955xState *s, int pin)
  {
      uint8_t reg   = PCA9552_LS0 + (pin / 4);
      uint8_t shift = (pin % 4) << 1;
@@ -XXX,XX +XXX,XX @@ static uint8_t pca9552_pin_get_config(PCA9552State *s, int pin)
      return extract32(s->regs[reg], shift, 2);
  }
 -static void pca9552_update_pin_input(PCA9552State *s)
 +static void pca955x_update_pin_input(PCA955xState *s)
  {
      int i;
-     for (i = 0; i < s->pin_count; i++) {
+     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &qsf);
-         uint8_t input_reg = PCA9552_INPUT0 + (i / 8);
++    set_float_default_nan_pattern(0b01000000, &qsf);
-         uint8_t input_shift = (i % 8);
+     set_float_rounding_mode(float_round_nearest_even, &qsf);
--        uint8_t config = pca9552_pin_get_config(s, i);
-+        uint8_t config = pca955x_pin_get_config(s, i);
+     test.d = 0.0;
+diff --git a/tests/fp/fp-test.c b/tests/fp/fp-test.c
-         switch (config) {
+index XXXXXXX..XXXXXXX 100644
-         case PCA9552_LED_ON:
+--- a/tests/fp/fp-test.c
-@@ -XXX,XX +XXX,XX @@ static void pca9552_update_pin_input(PCA9552State *s)
++++ b/tests/fp/fp-test.c
-     }
+@@ -XXX,XX +XXX,XX @@ void run_test(void)
  }
 -static uint8_t pca9552_read(PCA9552State *s, uint8_t reg)
 +static uint8_t pca955x_read(PCA955xState *s, uint8_t reg)
  {
      switch (reg) {
      case PCA9552_INPUT0:
@@ -XXX,XX +XXX,XX @@ static uint8_t pca9552_read(PCA9552State *s, uint8_t reg)
      }
  }
 -static void pca9552_write(PCA9552State *s, uint8_t reg, uint8_t data)
 +static void pca955x_write(PCA955xState *s, uint8_t reg, uint8_t data)
  {
      switch (reg) {
      case PCA9552_PSC0:
@@ -XXX,XX +XXX,XX @@ static void pca9552_write(PCA9552State *s, uint8_t reg, uint8_t data)
      case PCA9552_LS2:
      case PCA9552_LS3:
          s->regs[reg] = data;
 -        pca9552_update_pin_input(s);
 +        pca955x_update_pin_input(s);
          break;
      case PCA9552_INPUT0:
@@ -XXX,XX +XXX,XX @@ static void pca9552_write(PCA9552State *s, uint8_t reg, uint8_t data)
   * after each byte is sent to or received by the device. The index
   * rollovers to 0 when the maximum register address is reached.
   */
 -static void pca9552_autoinc(PCA9552State *s)
 +static void pca955x_autoinc(PCA955xState *s)
  {
      if (s->pointer != 0xFF && s->pointer & PCA9552_AUTOINC) {
          uint8_t reg = s->pointer & 0xf;
@@ -XXX,XX +XXX,XX @@ static void pca9552_autoinc(PCA9552State *s)
      }
  }
 -static uint8_t pca9552_recv(I2CSlave *i2c)
 +static uint8_t pca955x_recv(I2CSlave *i2c)
  {
 -    PCA9552State *s = PCA9552(i2c);
 +    PCA955xState *s = PCA955X(i2c);
      uint8_t ret;
 -    ret = pca9552_read(s, s->pointer & 0xf);
 +    ret = pca955x_read(s, s->pointer & 0xf);
      /*
       * From the Specs:
@@ -XXX,XX +XXX,XX @@ static uint8_t pca9552_recv(I2CSlave *i2c)
                        __func__);
      }
 -    pca9552_autoinc(s);
 +    pca955x_autoinc(s);
      return ret;
  }
 -static int pca9552_send(I2CSlave *i2c, uint8_t data)
 +static int pca955x_send(I2CSlave *i2c, uint8_t data)
  {
 -    PCA9552State *s = PCA9552(i2c);
 +    PCA955xState *s = PCA955X(i2c);
      /* First byte sent by is the register address */
      if (s->len == 0) {
          s->pointer = data;
          s->len++;
      } else {
 -        pca9552_write(s, s->pointer & 0xf, data);
 +        pca955x_write(s, s->pointer & 0xf, data);
 -        pca9552_autoinc(s);
 +        pca955x_autoinc(s);
      }
      return 0;
  }
 -static int pca9552_event(I2CSlave *i2c, enum i2c_event event)
 +static int pca955x_event(I2CSlave *i2c, enum i2c_event event)
  {
 -    PCA9552State *s = PCA9552(i2c);
 +    PCA955xState *s = PCA955X(i2c);
      s->len = 0;
      return 0;
  }
 -static void pca9552_get_led(Object *obj, Visitor *v, const char *name,
 +static void pca955x_get_led(Object *obj, Visitor *v, const char *name,
                              void *opaque, Error **errp)
  {
 -    PCA9552State *s = PCA9552(obj);
 +    PCA955xState *s = PCA955X(obj);
      int led, rc, reg;
      uint8_t state;
@@ -XXX,XX +XXX,XX @@ static void pca9552_get_led(Object *obj, Visitor *v, const char *name,
       * reading the INPUTx reg
       */
-     reg = PCA9552_LS0 + led / 4;
+     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &qsf);
--    state = (pca9552_read(s, reg) >> (led % 8)) & 0x3;
+     set_float_3nan_prop_rule(float_3nan_prop_s_cab, &qsf);
-+    state = (pca955x_read(s, reg) >> (led % 8)) & 0x3;
++    set_float_default_nan_pattern(0b01000000, &qsf);
-     visit_type_str(v, name, (char **)&led_state[state], errp);
+     set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, &qsf);
- }
+     genCases_setLevel(test_level);
@@ -XXX,XX +XXX,XX @@ static inline uint8_t pca955x_ledsel(uint8_t oldval, int led_num, int state)
                  ((state & 0x3) << (led_num << 1));
  }
 -static void pca9552_set_led(Object *obj, Visitor *v, const char *name,
 +static void pca955x_set_led(Object *obj, Visitor *v, const char *name,
                              void *opaque, Error **errp)
  {
 -    PCA9552State *s = PCA9552(obj);
 +    PCA955xState *s = PCA955X(obj);
      Error *local_err = NULL;
      int led, rc, reg, val;
      uint8_t state;
@@ -XXX,XX +XXX,XX @@ static void pca9552_set_led(Object *obj, Visitor *v, const char *name,
      }
      reg = PCA9552_LS0 + led / 4;
 -    val = pca9552_read(s, reg);
 +    val = pca955x_read(s, reg);
      val = pca955x_ledsel(val, led % 4, state);
 -    pca9552_write(s, reg, val);
 +    pca955x_write(s, reg, val);
  }
  static const VMStateDescription pca9552_vmstate = {
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription pca9552_vmstate = {
      .version_id = 0,
      .minimum_version_id = 0,
      .fields = (VMStateField[]) {
 -        VMSTATE_UINT8(len, PCA9552State),
 -        VMSTATE_UINT8(pointer, PCA9552State),
 -        VMSTATE_UINT8_ARRAY(regs, PCA9552State, PCA9552_NR_REGS),
 -        VMSTATE_I2C_SLAVE(i2c, PCA9552State),
 +        VMSTATE_UINT8(len, PCA955xState),
 +        VMSTATE_UINT8(pointer, PCA955xState),
 +        VMSTATE_UINT8_ARRAY(regs, PCA955xState, PCA955X_NR_REGS),
 +        VMSTATE_I2C_SLAVE(i2c, PCA955xState),
          VMSTATE_END_OF_LIST()
      }
  };
  static void pca9552_reset(DeviceState *dev)
  {
 -    PCA9552State *s = PCA9552(dev);
 +    PCA955xState *s = PCA955X(dev);
      s->regs[PCA9552_PSC0] = 0xFF;
      s->regs[PCA9552_PWM0] = 0x80;
@@ -XXX,XX +XXX,XX @@ static void pca9552_reset(DeviceState *dev)
      s->regs[PCA9552_LS2] = 0x55;
      s->regs[PCA9552_LS3] = 0x55;
 -    pca9552_update_pin_input(s);
 +    pca955x_update_pin_input(s);
      s->pointer = 0xFF;
      s->len = 0;
  }
 -static void pca9552_initfn(Object *obj)
 +static void pca955x_initfn(Object *obj)
  {
 -    PCA9552State *s = PCA9552(obj);
 +    PCA955xState *s = PCA955X(obj);
      int led;
      /* If support for the other PCA955X devices are implemented, these
@@ -XXX,XX +XXX,XX @@ static void pca9552_initfn(Object *obj)
          char *name;
          name = g_strdup_printf("led%d", led);
 -        object_property_add(obj, name, "bool", pca9552_get_led, pca9552_set_led,
 +        object_property_add(obj, name, "bool", pca955x_get_led, pca955x_set_led,
                              NULL, NULL);
          g_free(name);
      }
@@ -XXX,XX +XXX,XX @@ static void pca9552_class_init(ObjectClass *klass, void *data)
      DeviceClass *dc = DEVICE_CLASS(klass);
      I2CSlaveClass *k = I2C_SLAVE_CLASS(klass);
 -    k->event = pca9552_event;
 -    k->recv = pca9552_recv;
 -    k->send = pca9552_send;
 +    k->event = pca955x_event;
 +    k->recv = pca955x_recv;
 +    k->send = pca955x_send;
      dc->reset = pca9552_reset;
      dc->vmsd = &pca9552_vmstate;
  }
@@ -XXX,XX +XXX,XX @@ static void pca9552_class_init(ObjectClass *klass, void *data)
  static const TypeInfo pca9552_info = {
      .name          = TYPE_PCA9552,
      .parent        = TYPE_I2C_SLAVE,
 -    .instance_init = pca9552_initfn,
 -    .instance_size = sizeof(PCA9552State),
 +    .instance_init = pca955x_initfn,
 +    .instance_size = sizeof(PCA955xState),
      .class_init    = pca9552_class_init,
  };
 -static void pca9552_register_types(void)
 +static void pca955x_register_types(void)
  {
      type_register_static(&pca9552_info);
  }
 -type_init(pca9552_register_types)
 +type_init(pca955x_register_types)
 --
-.20.1
+.34.1

-New patch
+[PULL 42/72] target/microblaze: Set default NaN pattern explicitly
+Set the default NaN pattern explicitly, and remove the ifdef from
+parts64_default_nan().
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-37-peter.maydell@linaro.org
+---
+ target/microblaze/cpu.c        | 2 ++
+ fpu/softfloat-specialize.c.inc | 3 +--
+files changed, 3 insertions(+), 2 deletions(-)
+diff --git a/target/microblaze/cpu.c b/target/microblaze/cpu.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/microblaze/cpu.c
++++ b/target/microblaze/cpu.c
+@@ -XXX,XX +XXX,XX @@ static void mb_cpu_reset_hold(Object *obj, ResetType type)
+      * this architecture.
+      */
+     set_float_2nan_prop_rule(float_2nan_prop_x87, &env->fp_status);
++    /* Default NaN: sign bit set, most significant frac bit set */
++    set_float_default_nan_pattern(0b11000000, &env->fp_status);
+ #if defined(CONFIG_USER_ONLY)
+     /* start in user mode with interrupts enabled.  */
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
+index XXXXXXX..XXXXXXX 100644
+--- a/fpu/softfloat-specialize.c.inc
++++ b/fpu/softfloat-specialize.c.inc
+@@ -XXX,XX +XXX,XX @@ static void parts64_default_nan(FloatParts64 *p, float_status *status)
+ #if defined(TARGET_SPARC) || defined(TARGET_M68K)
+         /* Sign bit clear, all frac bits set */
+         dnan_pattern = 0b01111111;
+-#elif defined(TARGET_I386) || defined(TARGET_X86_64)    \
+-    || defined(TARGET_MICROBLAZE)
++#elif defined(TARGET_I386) || defined(TARGET_X86_64)
+         /* Sign bit set, most significant frac bit set */
+         dnan_pattern = 0b11000000;
+ #elif defined(TARGET_HPPA)
+--
+.34.1

-[PULL 09/57] hw/misc/pca9552: Trace GPIO High/Low events
+[PULL 43/72] target/i386: Set default NaN pattern explicitly
-From: Philippe Mathieu-Daudé <f4bug@amsat.org>
+Set the default NaN pattern explicitly, and remove the ifdef from
 parts64_default_nan().
-Add a trivial representation of the PCA9552 GPIOs.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20241202131347.498124-38-peter.maydell@linaro.org
 ---
  target/i386/tcg/fpu_helper.c   | 4 ++++
  fpu/softfloat-specialize.c.inc | 3 ---
 files changed, 4 insertions(+), 3 deletions(-)
-Example booting obmc-phosphor-image:
+diff --git a/target/i386/tcg/fpu_helper.c b/target/i386/tcg/fpu_helper.c
   $ qemu-system-arm -M witherspoon-bmc -trace pca955x_gpio_status
   1592689902.327837:pca955x_gpio_status pca-unspecified GPIOs 0-15 [*...............]
   1592689902.329934:pca955x_gpio_status pca-unspecified GPIOs 0-15 [**..............]
   1592689902.330717:pca955x_gpio_status pca-unspecified GPIOs 0-15 [***.............]
   1592689902.331431:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****............]
   1592689902.332163:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****.........*..]
   1592689902.332888:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****.........**.]
   1592689902.333629:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****.........***]
   1592690032.793289:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****.........*.*]
   1592690033.303163:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****.........***]
   1592690033.812962:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****.........*.*]
   1592690034.323234:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****.........***]
   1592690034.832922:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****.........*.*]
 We notice the GPIO #14 (front-power LED) starts to blink.
 This LED is described in the witherspoon device-tree [*]:
   front-power {
       retain-state-shutdown;
       default-state = "keep";
       gpios = <&pca0 14 GPIO_ACTIVE_LOW>;
   };
 [*] https://git.kernel.org/pub/scm/linux/kernel/git/torvalds/linux.git/tree/arch/arm/boot/dts/aspeed-bmc-opp-witherspoon.dts?id=b1f9be9392f0#n140
 Suggested-by: Cédric Le Goater <clg@kaod.org>
 Reviewed-by: Cédric Le Goater <clg@kaod.org>
 Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
 Tested-by: Cédric Le Goater <clg@kaod.org>
 Message-id: 20200623072723.6324-7-f4bug@amsat.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  hw/misc/pca9552.c    | 39 +++++++++++++++++++++++++++++++++++++++
  hw/misc/trace-events |  3 +++
 files changed, 42 insertions(+)
 diff --git a/hw/misc/pca9552.c b/hw/misc/pca9552.c
 index XXXXXXX..XXXXXXX 100644
---- a/hw/misc/pca9552.c
+--- a/target/i386/tcg/fpu_helper.c
-+++ b/hw/misc/pca9552.c
++++ b/target/i386/tcg/fpu_helper.c
-@@ -XXX,XX +XXX,XX @@
+@@ -XXX,XX +XXX,XX @@ void cpu_init_fp_statuses(CPUX86State *env)
- #include "qemu/osdep.h"
+      */
- #include "qemu/log.h"
+     set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->sse_status);
- #include "qemu/module.h"
+     set_float_3nan_prop_rule(float_3nan_prop_abc, &env->sse_status);
-+#include "qemu/bitops.h"
++    /* Default NaN: sign bit set, most significant frac bit set */
- #include "hw/qdev-properties.h"
++    set_float_default_nan_pattern(0b11000000, &env->fp_status);
- #include "hw/misc/pca9552.h"
++    set_float_default_nan_pattern(0b11000000, &env->mmx_status);
- #include "hw/misc/pca9552_regs.h"
++    set_float_default_nan_pattern(0b11000000, &env->sse_status);
  #include "migration/vmstate.h"
  #include "qapi/error.h"
  #include "qapi/visitor.h"
 +#include "trace.h"
  typedef struct PCA955xClass {
      /*< private >*/
@@ -XXX,XX +XXX,XX @@ static uint8_t pca955x_pin_get_config(PCA955xState *s, int pin)
      return extract32(s->regs[reg], shift, 2);
  }
-+/* Return INPUT status (bit #N belongs to GPIO #N) */
+ static inline uint8_t save_exception_flags(CPUX86State *env)
-+static uint16_t pca955x_pins_get_status(PCA955xState *s)
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 +{
 +    return (s->regs[PCA9552_INPUT1] << 8) | s->regs[PCA9552_INPUT0];
 +}
 +
 +static void pca955x_display_pins_status(PCA955xState *s,
 +                                        uint16_t previous_pins_status)
 +{
 +    PCA955xClass *k = PCA955X_GET_CLASS(s);
 +    uint16_t pins_status, pins_changed;
 +    int i;
 +
 +    pins_status = pca955x_pins_get_status(s);
 +    pins_changed = previous_pins_status ^ pins_status;
 +    if (!pins_changed) {
 +        return;
 +    }
 +    if (trace_event_get_state_backends(TRACE_PCA955X_GPIO_STATUS)) {
 +        char *buf = g_newa(char, k->pin_count + 1);
 +
 +        for (i = 0; i < k->pin_count; i++) {
 +            if (extract32(pins_status, i, 1)) {
 +                buf[i] = '*';
 +            } else {
 +                buf[i] = '.';
 +            }
 +        }
 +        buf[i] = '\0';
 +        trace_pca955x_gpio_status(s->description, buf);
 +    }
 +}
 +
  static void pca955x_update_pin_input(PCA955xState *s)
  {
      PCA955xClass *k = PCA955X_GET_CLASS(s);
@@ -XXX,XX +XXX,XX @@ static uint8_t pca955x_read(PCA955xState *s, uint8_t reg)
  static void pca955x_write(PCA955xState *s, uint8_t reg, uint8_t data)
  {
 +    uint16_t pins_status;
 +
      switch (reg) {
      case PCA9552_PSC0:
      case PCA9552_PWM0:
@@ -XXX,XX +XXX,XX @@ static void pca955x_write(PCA955xState *s, uint8_t reg, uint8_t data)
      case PCA9552_LS1:
      case PCA9552_LS2:
      case PCA9552_LS3:
 +        pins_status = pca955x_pins_get_status(s);
          s->regs[reg] = data;
          pca955x_update_pin_input(s);
 +        pca955x_display_pins_status(s, pins_status);
          break;
      case PCA9552_INPUT0:
 diff --git a/hw/misc/trace-events b/hw/misc/trace-events
 index XXXXXXX..XXXXXXX 100644
---- a/hw/misc/trace-events
+--- a/fpu/softfloat-specialize.c.inc
-+++ b/hw/misc/trace-events
++++ b/fpu/softfloat-specialize.c.inc
-@@ -XXX,XX +XXX,XX @@ via1_adb_poll(uint8_t data, const char *vadbint, int status, int index, int size
+@@ -XXX,XX +XXX,XX @@ static void parts64_default_nan(FloatParts64 *p, float_status *status)
- # grlib_ahb_apb_pnp.c
+ #if defined(TARGET_SPARC) || defined(TARGET_M68K)
- grlib_ahb_pnp_read(uint64_t addr, uint32_t value) "AHB PnP read addr:0x%03"PRIx64" data:0x%08x"
+         /* Sign bit clear, all frac bits set */
- grlib_apb_pnp_read(uint64_t addr, uint32_t value) "APB PnP read addr:0x%03"PRIx64" data:0x%08x"
+         dnan_pattern = 0b01111111;
-+
+-#elif defined(TARGET_I386) || defined(TARGET_X86_64)
-+# pca9552.c
+-        /* Sign bit set, most significant frac bit set */
-+pca955x_gpio_status(const char *description, const char *buf) "%s GPIOs 0-15 [%s]"
+-        dnan_pattern = 0b11000000;
  #elif defined(TARGET_HPPA)
          /* Sign bit clear, msb-1 frac bit set */
          dnan_pattern = 0b00100000;
 --
-.20.1
+.34.1

-[PULL 11/57] hw/misc/pca9552: Trace GPIO change events
+[PULL 44/72] target/hppa: Set default NaN pattern explicitly
-From: Philippe Mathieu-Daudé <f4bug@amsat.org>
+Set the default NaN pattern explicitly, and remove the ifdef from
 parts64_default_nan().
-Emit a trace event when a GPIO change its state.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20241202131347.498124-39-peter.maydell@linaro.org
 ---
  target/hppa/fpu_helper.c       | 2 ++
  fpu/softfloat-specialize.c.inc | 3 ---
 files changed, 2 insertions(+), 3 deletions(-)
-Example booting obmc-phosphor-image:
+diff --git a/target/hppa/fpu_helper.c b/target/hppa/fpu_helper.c
   $ qemu-system-arm -M witherspoon-bmc -trace pca955x_gpio_change
   1592690552.687372:pca955x_gpio_change pca1 GPIO id:0 status: 0 -> 1
   1592690552.690169:pca955x_gpio_change pca1 GPIO id:1 status: 0 -> 1
   1592690552.691673:pca955x_gpio_change pca1 GPIO id:2 status: 0 -> 1
   1592690552.696886:pca955x_gpio_change pca1 GPIO id:3 status: 0 -> 1
   1592690552.698614:pca955x_gpio_change pca1 GPIO id:13 status: 0 -> 1
   1592690552.699833:pca955x_gpio_change pca1 GPIO id:14 status: 0 -> 1
   1592690552.700842:pca955x_gpio_change pca1 GPIO id:15 status: 0 -> 1
   1592690683.841921:pca955x_gpio_change pca1 GPIO id:14 status: 1 -> 0
   1592690683.861660:pca955x_gpio_change pca1 GPIO id:14 status: 0 -> 1
   1592690684.371460:pca955x_gpio_change pca1 GPIO id:14 status: 1 -> 0
   1592690684.882115:pca955x_gpio_change pca1 GPIO id:14 status: 0 -> 1
   1592690685.391411:pca955x_gpio_change pca1 GPIO id:14 status: 1 -> 0
   1592690685.901391:pca955x_gpio_change pca1 GPIO id:14 status: 0 -> 1
   1592690686.411678:pca955x_gpio_change pca1 GPIO id:14 status: 1 -> 0
   1592690686.921279:pca955x_gpio_change pca1 GPIO id:14 status: 0 -> 1
 We notice the GPIO #14 (front-power LED) starts to blink.
 This LED is described in the witherspoon device-tree [*]:
   front-power {
       retain-state-shutdown;
       default-state = "keep";
       gpios = <&pca0 14 GPIO_ACTIVE_LOW>;
   };
 [*] https://git.kernel.org/pub/scm/linux/kernel/git/torvalds/linux.git/tree/arch/arm/boot/dts/aspeed-bmc-opp-witherspoon.dts?id=b1f9be9392f0#n140
 Reviewed-by: Cédric Le Goater <clg@kaod.org>
 Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
 Tested-by: Cédric Le Goater <clg@kaod.org>
 Message-id: 20200623072723.6324-9-f4bug@amsat.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  hw/misc/pca9552.c    | 15 +++++++++++++++
  hw/misc/trace-events |  1 +
 files changed, 16 insertions(+)
 diff --git a/hw/misc/pca9552.c b/hw/misc/pca9552.c
 index XXXXXXX..XXXXXXX 100644
---- a/hw/misc/pca9552.c
+--- a/target/hppa/fpu_helper.c
-+++ b/hw/misc/pca9552.c
++++ b/target/hppa/fpu_helper.c
-@@ -XXX,XX +XXX,XX @@ static void pca955x_display_pins_status(PCA955xState *s,
+@@ -XXX,XX +XXX,XX @@ void HELPER(loaded_fr0)(CPUHPPAState *env)
-         buf[i] = '\0';
+     set_float_3nan_prop_rule(float_3nan_prop_abc, &env->fp_status);
-         trace_pca955x_gpio_status(s->description, buf);
+     /* For inf * 0 + NaN, return the input NaN */
-     }
+     set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
-+    if (trace_event_get_state_backends(TRACE_PCA955X_GPIO_CHANGE)) {
++    /* Default NaN: sign bit clear, msb-1 frac bit set */
-+        for (i = 0; i < k->pin_count; i++) {
++    set_float_default_nan_pattern(0b00100000, &env->fp_status);
 +            if (extract32(pins_changed, i, 1)) {
 +                unsigned new_state = extract32(pins_status, i, 1);
 +
 +                /*
 +                 * We display the state using the PCA logic ("active-high").
 +                 * This is not the state of the LED, which signal might be
 +                 * wired "active-low" on the board.
 +                 */
 +                trace_pca955x_gpio_change(s->description, i,
 +                                          !new_state, new_state);
 +            }
 +        }
 +    }
  }
- static void pca955x_update_pin_input(PCA955xState *s)
+ void cpu_hppa_loaded_fr0(CPUHPPAState *env)
-diff --git a/hw/misc/trace-events b/hw/misc/trace-events
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 index XXXXXXX..XXXXXXX 100644
---- a/hw/misc/trace-events
+--- a/fpu/softfloat-specialize.c.inc
-+++ b/hw/misc/trace-events
++++ b/fpu/softfloat-specialize.c.inc
-@@ -XXX,XX +XXX,XX @@ grlib_apb_pnp_read(uint64_t addr, uint32_t value) "APB PnP read addr:0x%03"PRIx6
+@@ -XXX,XX +XXX,XX @@ static void parts64_default_nan(FloatParts64 *p, float_status *status)
+ #if defined(TARGET_SPARC) || defined(TARGET_M68K)
- # pca9552.c
+         /* Sign bit clear, all frac bits set */
- pca955x_gpio_status(const char *description, const char *buf) "%s GPIOs 0-15 [%s]"
+         dnan_pattern = 0b01111111;
-+pca955x_gpio_change(const char *description, unsigned id, unsigned prev_state, unsigned current_state) "%s GPIO id:%u status: %u -> %u"
+-#elif defined(TARGET_HPPA)
 -        /* Sign bit clear, msb-1 frac bit set */
 -        dnan_pattern = 0b00100000;
  #elif defined(TARGET_HEXAGON)
          /* Sign bit set, all frac bits set. */
          dnan_pattern = 0b11111111;
 --
-.20.1
+.34.1

-New patch
+[PULL 45/72] target/alpha: Set default NaN pattern explicitly
+Set the default NaN pattern explicitly for the alpha target.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-40-peter.maydell@linaro.org
+---
+ target/alpha/cpu.c | 2 ++
+file changed, 2 insertions(+)
+diff --git a/target/alpha/cpu.c b/target/alpha/cpu.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/alpha/cpu.c
++++ b/target/alpha/cpu.c
+@@ -XXX,XX +XXX,XX @@ static void alpha_cpu_initfn(Object *obj)
+      * operand in Fa. That is float_2nan_prop_ba.
+      */
+     set_float_2nan_prop_rule(float_2nan_prop_x87, &env->fp_status);
++    /* Default NaN: sign bit clear, msb frac bit set */
++    set_float_default_nan_pattern(0b01000000, &env->fp_status);
+ #if defined(CONFIG_USER_ONLY)
+     env->flags = ENV_FLAG_PS_USER | ENV_FLAG_FEN;
+     cpu_alpha_store_fpcr(env, (uint64_t)(FPCR_INVD | FPCR_DZED | FPCR_OVFD
+--
+.34.1

-[PULL 55/57] target/arm: Create tagged ram when MTE is enabled
+[PULL 46/72] target/arm: Set default NaN pattern explicitly
-From: Richard Henderson <richard.henderson@linaro.org>
+Set the default NaN pattern explicitly for the arm target.
 This includes setting it for the old linux-user nwfpe emulation.
 For nwfpe, our default doesn't match the real kernel, but we
 avoid making a behaviour change in this commit.
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Message-id: 20200626033144.790098-44-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-41-peter.maydell@linaro.org
 ---
- target/arm/cpu.h |  6 ++++++
+ linux-user/arm/nwfpe/fpa11.c | 5 +++++
- hw/arm/virt.c    | 55 ++++++++++++++++++++++++++++++++++++++++++++++--
+ target/arm/cpu.c             | 2 ++
- target/arm/cpu.c | 52 +++++++++++++++++++++++++++++++++++++++++----
+files changed, 7 insertions(+)
 files changed, 107 insertions(+), 6 deletions(-)
-diff --git a/target/arm/cpu.h b/target/arm/cpu.h
+diff --git a/linux-user/arm/nwfpe/fpa11.c b/linux-user/arm/nwfpe/fpa11.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu.h
+--- a/linux-user/arm/nwfpe/fpa11.c
-+++ b/target/arm/cpu.h
++++ b/linux-user/arm/nwfpe/fpa11.c
-@@ -XXX,XX +XXX,XX @@ struct ARMCPU {
+@@ -XXX,XX +XXX,XX @@ void resetFPA11(void)
-     /* MemoryRegion to use for secure physical accesses */
+    * this late date.
-     MemoryRegion *secure_memory;
+    */
+   set_float_2nan_prop_rule(float_2nan_prop_s_ab, &fpa11->fp_status);
-+    /* MemoryRegion to use for allocation tag accesses */
++  /*
-+    MemoryRegion *tag_memory;
++   * Use the same default NaN value as Arm VFP. This doesn't match
-+    MemoryRegion *secure_tag_memory;
++   * the Linux kernel's nwfpe emulation, which uses an all-1s value.
-+
++   */
-     /* For v8M, pointer to the IDAU interface provided by board/SoC */
++  set_float_default_nan_pattern(0b01000000, &fpa11->fp_status);
      Object *idau;
@@ -XXX,XX +XXX,XX @@ typedef enum ARMMMUIdxBit {
  typedef enum ARMASIdx {
      ARMASIdx_NS = 0,
      ARMASIdx_S = 1,
 +    ARMASIdx_TagNS = 2,
 +    ARMASIdx_TagS = 3,
  } ARMASIdx;
  /* Return the Exception Level targeted by debug exceptions. */
 diff --git a/hw/arm/virt.c b/hw/arm/virt.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/arm/virt.c
 +++ b/hw/arm/virt.c
@@ -XXX,XX +XXX,XX @@ static void create_platform_bus(VirtMachineState *vms)
                                  sysbus_mmio_get_region(s, 0));
  }
-+static void create_tag_ram(MemoryRegion *tag_sysmem,
+ void SetRoundingMode(const unsigned int opcode)
 +                           hwaddr base, hwaddr size,
 +                           const char *name)
 +{
 +    MemoryRegion *tagram = g_new(MemoryRegion, 1);
 +
 +    memory_region_init_ram(tagram, NULL, name, size / 32, &error_fatal);
 +    memory_region_add_subregion(tag_sysmem, base / 32, tagram);
 +}
 +
  static void create_secure_ram(VirtMachineState *vms,
 -                              MemoryRegion *secure_sysmem)
 +                              MemoryRegion *secure_sysmem,
 +                              MemoryRegion *secure_tag_sysmem)
  {
      MemoryRegion *secram = g_new(MemoryRegion, 1);
      char *nodename;
@@ -XXX,XX +XXX,XX @@ static void create_secure_ram(VirtMachineState *vms,
      qemu_fdt_setprop_string(vms->fdt, nodename, "status", "disabled");
      qemu_fdt_setprop_string(vms->fdt, nodename, "secure-status", "okay");
 +    if (secure_tag_sysmem) {
 +        create_tag_ram(secure_tag_sysmem, base, size, "mach-virt.secure-tag");
 +    }
 +
      g_free(nodename);
  }
@@ -XXX,XX +XXX,XX @@ static void machvirt_init(MachineState *machine)
      const CPUArchIdList *possible_cpus;
      MemoryRegion *sysmem = get_system_memory();
      MemoryRegion *secure_sysmem = NULL;
 +    MemoryRegion *tag_sysmem = NULL;
 +    MemoryRegion *secure_tag_sysmem = NULL;
      int n, virt_max_cpus;
      bool firmware_loaded;
      bool aarch64 = true;
@@ -XXX,XX +XXX,XX @@ static void machvirt_init(MachineState *machine)
                                       "secure-memory", &error_abort);
          }
 +        /*
 +         * The cpu adds the property if and only if MemTag is supported.
 +         * If it is, we must allocate the ram to back that up.
 +         */
 +        if (object_property_find(cpuobj, "tag-memory", NULL)) {
 +            if (!tag_sysmem) {
 +                tag_sysmem = g_new(MemoryRegion, 1);
 +                memory_region_init(tag_sysmem, OBJECT(machine),
 +                                   "tag-memory", UINT64_MAX / 32);
 +
 +                if (vms->secure) {
 +                    secure_tag_sysmem = g_new(MemoryRegion, 1);
 +                    memory_region_init(secure_tag_sysmem, OBJECT(machine),
 +                                       "secure-tag-memory", UINT64_MAX / 32);
 +
 +                    /* As with ram, secure-tag takes precedence over tag.  */
 +                    memory_region_add_subregion_overlap(secure_tag_sysmem, 0,
 +                                                        tag_sysmem, -1);
 +                }
 +            }
 +
 +            object_property_set_link(cpuobj, OBJECT(tag_sysmem),
 +                                     "tag-memory", &error_abort);
 +            if (vms->secure) {
 +                object_property_set_link(cpuobj, OBJECT(secure_tag_sysmem),
 +                                         "secure-tag-memory", &error_abort);
 +            }
 +        }
 +
          qdev_realize(DEVICE(cpuobj), NULL, &error_fatal);
          object_unref(cpuobj);
      }
@@ -XXX,XX +XXX,XX @@ static void machvirt_init(MachineState *machine)
      create_uart(vms, VIRT_UART, sysmem, serial_hd(0));
      if (vms->secure) {
 -        create_secure_ram(vms, secure_sysmem);
 +        create_secure_ram(vms, secure_sysmem, secure_tag_sysmem);
          create_uart(vms, VIRT_SECURE_UART, secure_sysmem, serial_hd(1));
      }
 +    if (tag_sysmem) {
 +        create_tag_ram(tag_sysmem, vms->memmap[VIRT_MEM].base,
 +                       machine->ram_size, "mach-virt.tag");
 +    }
 +
      vms->highmem_ecam &= vms->highmem && (!firmware_loaded || aarch64);
      create_rtc(vms);
 diff --git a/target/arm/cpu.c b/target/arm/cpu.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu.c
 +++ b/target/arm/cpu.c
-@@ -XXX,XX +XXX,XX @@ void arm_cpu_post_init(Object *obj)
+@@ -XXX,XX +XXX,XX @@ void arm_register_el_change_hook(ARMCPU *cpu, ARMELChangeHookFn *hook,
-     if (kvm_enabled()) {
+  *    the pseudocode function the arguments are in the order c, a, b.
-         kvm_arm_add_vcpu_properties(obj);
+  *  * 0 * Inf + NaN returns the default NaN if the input NaN is quiet,
-     }
+  *    and the input NaN if it is signalling
-+
++ *  * Default NaN has sign bit clear, msb frac bit set
-+#ifndef CONFIG_USER_ONLY
+  */
-+    if (arm_feature(&cpu->env, ARM_FEATURE_AARCH64) &&
+ static void arm_set_default_fp_behaviours(float_status *s)
-+        cpu_isar_feature(aa64_mte, cpu)) {
+ {
-+        object_property_add_link(obj, "tag-memory",
+@@ -XXX,XX +XXX,XX @@ static void arm_set_default_fp_behaviours(float_status *s)
-+                                 TYPE_MEMORY_REGION,
+     set_float_2nan_prop_rule(float_2nan_prop_s_ab, s);
-+                                 (Object **)&cpu->tag_memory,
+     set_float_3nan_prop_rule(float_3nan_prop_s_cab, s);
-+                                 qdev_prop_allow_set_link_before_realize,
+     set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, s);
-+                                 OBJ_PROP_LINK_STRONG);
++    set_float_default_nan_pattern(0b01000000, s);
 +
 +        if (arm_feature(&cpu->env, ARM_FEATURE_EL3)) {
 +            object_property_add_link(obj, "secure-tag-memory",
 +                                     TYPE_MEMORY_REGION,
 +                                     (Object **)&cpu->secure_tag_memory,
 +                                     qdev_prop_allow_set_link_before_realize,
 +                                     OBJ_PROP_LINK_STRONG);
 +        }
 +    }
 +#endif
  }
- static void arm_cpu_finalizefn(Object *obj)
+ static void cp_reg_reset(gpointer key, gpointer value, gpointer opaque)
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
  #ifndef CONFIG_USER_ONLY
      MachineState *ms = MACHINE(qdev_get_machine());
      unsigned int smp_cpus = ms->smp.cpus;
 +    bool has_secure = cpu->has_el3 || arm_feature(env, ARM_FEATURE_M_SECURITY);
 -    if (cpu->has_el3 || arm_feature(env, ARM_FEATURE_M_SECURITY)) {
 -        cs->num_ases = 2;
 +    /*
 +     * We must set cs->num_ases to the final value before
 +     * the first call to cpu_address_space_init.
 +     */
 +    if (cpu->tag_memory != NULL) {
 +        cs->num_ases = 3 + has_secure;
 +    } else {
 +        cs->num_ases = 1 + has_secure;
 +    }
 +    if (has_secure) {
          if (!cpu->secure_memory) {
              cpu->secure_memory = cs->memory;
          }
          cpu_address_space_init(cs, ARMASIdx_S, "cpu-secure-memory",
                                 cpu->secure_memory);
 -    } else {
 -        cs->num_ases = 1;
      }
 +
 +    if (cpu->tag_memory != NULL) {
 +        cpu_address_space_init(cs, ARMASIdx_TagNS, "cpu-tag-memory",
 +                               cpu->tag_memory);
 +        if (has_secure) {
 +            cpu_address_space_init(cs, ARMASIdx_TagS, "cpu-tag-memory",
 +                                   cpu->secure_tag_memory);
 +        }
 +    } else if (cpu_isar_feature(aa64_mte, cpu)) {
 +        /*
 +         * Since there is no tag memory, we can't meaningfully support MTE
 +         * to its fullest.  To avoid problems later, when we would come to
 +         * use the tag memory, downgrade support to insns only.
 +         */
 +        cpu->isar.id_aa64pfr1 =
 +            FIELD_DP64(cpu->isar.id_aa64pfr1, ID_AA64PFR1, MTE, 1);
 +    }
 +
      cpu_address_space_init(cs, ARMASIdx_NS, "cpu-memory", cs->memory);
      /* No core_count specified, default to smp_cpus. */
 --
-.20.1
+.34.1

-[PULL 17/57] target/arm: Rename DISAS_UPDATE to DISAS_UPDATE_EXIT
+[PULL 47/72] target/loongarch: Set default NaN pattern explicitly
-From: Richard Henderson <richard.henderson@linaro.org>
+Set the default NaN pattern explicitly for loongarch.
-Emphasize that the is_jmp option exits to the main loop.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20241202131347.498124-42-peter.maydell@linaro.org
 ---
  target/loongarch/tcg/fpu_helper.c | 2 ++
 file changed, 2 insertions(+)
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+diff --git a/target/loongarch/tcg/fpu_helper.c b/target/loongarch/tcg/fpu_helper.c
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20200626033144.790098-6-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/translate.h         | 14 ++++++++------
  target/arm/translate-a64.c     |  8 ++++----
  target/arm/translate-vfp.inc.c |  4 ++--
  target/arm/translate.c         | 12 ++++++------
 files changed, 20 insertions(+), 18 deletions(-)
 diff --git a/target/arm/translate.h b/target/arm/translate.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.h
+--- a/target/loongarch/tcg/fpu_helper.c
-+++ b/target/arm/translate.h
++++ b/target/loongarch/tcg/fpu_helper.c
-@@ -XXX,XX +XXX,XX @@ static inline void disas_set_insn_syndrome(DisasContext *s, uint32_t syn)
+@@ -XXX,XX +XXX,XX @@ void restore_fp_status(CPULoongArchState *env)
+      */
- /* is_jmp field values */
+     set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
- #define DISAS_JUMP      DISAS_TARGET_0 /* only pc was modified dynamically */
+     set_float_3nan_prop_rule(float_3nan_prop_s_cab, &env->fp_status);
--#define DISAS_UPDATE    DISAS_TARGET_1 /* cpu state was modified dynamically */
++    /* Default NaN: sign bit clear, msb frac bit set */
-+/* CPU state was modified dynamically; exit to main loop for interrupts. */
++    set_float_default_nan_pattern(0b01000000, &env->fp_status);
 +#define DISAS_UPDATE_EXIT  DISAS_TARGET_1
  /* These instructions trap after executing, so the A32/T32 decoder must
   * defer them until after the conditional execution state has been updated.
   * WFI also needs special handling when single-stepping.
@@ -XXX,XX +XXX,XX @@ static inline void disas_set_insn_syndrome(DisasContext *s, uint32_t syn)
   * custom end-of-TB code)
   */
  #define DISAS_BX_EXCRET DISAS_TARGET_8
 -/* For instructions which want an immediate exit to the main loop,
 - * as opposed to attempting to use lookup_and_goto_ptr. Unlike
 - * DISAS_UPDATE this doesn't write the PC on exiting the translation
 - * loop so you need to ensure something (gen_a64_set_pc_im or runtime
 - * helper) has done so before we reach return from cpu_tb_exec.
 +/*
 + * For instructions which want an immediate exit to the main loop, as opposed
 + * to attempting to use lookup_and_goto_ptr.  Unlike DISAS_UPDATE_EXIT, this
 + * doesn't write the PC on exiting the translation loop so you need to ensure
 + * something (gen_a64_set_pc_im or runtime helper) has done so before we reach
 + * return from cpu_tb_exec.
   */
  #define DISAS_EXIT      DISAS_TARGET_9
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void handle_msr_i(DisasContext *s, uint32_t insn,
          gen_helper_msr_i_daifclear(cpu_env, t1);
          tcg_temp_free_i32(t1);
          /* For DAIFClear, exit the cpu loop to re-evaluate pending IRQs.  */
 -        s->base.is_jmp = DISAS_UPDATE;
 +        s->base.is_jmp = DISAS_UPDATE_EXIT;
          break;
      default:
@@ -XXX,XX +XXX,XX @@ static void handle_sys(DisasContext *s, uint32_t insn, bool isread,
      if ((tb_cflags(s->base.tb) & CF_USE_ICOUNT) && (ri->type & ARM_CP_IO)) {
          /* I/O operations must end the TB here (whether read or write) */
 -        s->base.is_jmp = DISAS_UPDATE;
 +        s->base.is_jmp = DISAS_UPDATE_EXIT;
      }
      if (!isread && !(ri->type & ARM_CP_SUPPRESS_TB_END)) {
          /*
@@ -XXX,XX +XXX,XX @@ static void handle_sys(DisasContext *s, uint32_t insn, bool isread,
           * but allow this to be suppressed by the register definition
           * (usually only necessary to work around guest bugs).
           */
 -        s->base.is_jmp = DISAS_UPDATE;
 +        s->base.is_jmp = DISAS_UPDATE_EXIT;
      }
  }
-@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_tb_stop(DisasContextBase *dcbase, CPUState *cpu)
+ int ieee_ex_to_loongarch(int xcpt)
              gen_goto_tb(dc, 1, dc->base.pc_next);
              break;
          default:
 -        case DISAS_UPDATE:
 +        case DISAS_UPDATE_EXIT:
              gen_a64_set_pc_im(dc->base.pc_next);
              /* fall through */
          case DISAS_EXIT:
 diff --git a/target/arm/translate-vfp.inc.c b/target/arm/translate-vfp.inc.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-vfp.inc.c
 +++ b/target/arm/translate-vfp.inc.c
@@ -XXX,XX +XXX,XX @@ static bool full_vfp_access_check(DisasContext *s, bool ignore_vfp_enabled)
               * this to be the last insn in the TB).
               */
              if (tb_cflags(s->base.tb) & CF_USE_ICOUNT) {
 -                s->base.is_jmp = DISAS_UPDATE;
 +                s->base.is_jmp = DISAS_UPDATE_EXIT;
                  gen_io_start();
              }
              gen_helper_v7m_preserve_fp_state(cpu_env);
@@ -XXX,XX +XXX,XX @@ static bool trans_VLLDM_VLSTM(DisasContext *s, arg_VLLDM_VLSTM *a)
      tcg_temp_free_i32(fptr);
      /* End the TB, because we have updated FP control bits */
 -    s->base.is_jmp = DISAS_UPDATE;
 +    s->base.is_jmp = DISAS_UPDATE_EXIT;
      return true;
  }
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void gen_msr_banked(DisasContext *s, int r, int sysm, int rn)
      tcg_temp_free_i32(tcg_tgtmode);
      tcg_temp_free_i32(tcg_regno);
      tcg_temp_free_i32(tcg_reg);
 -    s->base.is_jmp = DISAS_UPDATE;
 +    s->base.is_jmp = DISAS_UPDATE_EXIT;
  }
  static void gen_mrs_banked(DisasContext *s, int r, int sysm, int rn)
@@ -XXX,XX +XXX,XX @@ static void gen_mrs_banked(DisasContext *s, int r, int sysm, int rn)
      tcg_temp_free_i32(tcg_tgtmode);
      tcg_temp_free_i32(tcg_regno);
      store_reg(s, rn, tcg_reg);
 -    s->base.is_jmp = DISAS_UPDATE;
 +    s->base.is_jmp = DISAS_UPDATE_EXIT;
  }
  /* Store value to PC as for an exception return (ie don't
@@ -XXX,XX +XXX,XX @@ static void gen_srs(DisasContext *s,
          tcg_temp_free_i32(tmp);
      }
      tcg_temp_free_i32(addr);
 -    s->base.is_jmp = DISAS_UPDATE;
 +    s->base.is_jmp = DISAS_UPDATE_EXIT;
  }
  /* Generate a label used for skipping this instruction */
@@ -XXX,XX +XXX,XX @@ static bool trans_SETEND(DisasContext *s, arg_SETEND *a)
      }
      if (a->E != (s->be_data == MO_BE)) {
          gen_helper_setend(cpu_env);
 -        s->base.is_jmp = DISAS_UPDATE;
 +        s->base.is_jmp = DISAS_UPDATE_EXIT;
      }
      return true;
  }
@@ -XXX,XX +XXX,XX @@ static void arm_tr_tb_stop(DisasContextBase *dcbase, CPUState *cpu)
              break;
          case DISAS_NEXT:
          case DISAS_TOO_MANY:
 -        case DISAS_UPDATE:
 +        case DISAS_UPDATE_EXIT:
              gen_set_pc_im(dc, dc->base.pc_next);
              /* fall through */
          default:
@@ -XXX,XX +XXX,XX @@ static void arm_tr_tb_stop(DisasContextBase *dcbase, CPUState *cpu)
          case DISAS_JUMP:
              gen_goto_ptr();
              break;
 -        case DISAS_UPDATE:
 +        case DISAS_UPDATE_EXIT:
              gen_set_pc_im(dc, dc->base.pc_next);
              /* fall through */
          default:
 --
-.20.1
+.34.1

-New patch
+[PULL 48/72] target/m68k: Set default NaN pattern explicitly
+Set the default NaN pattern explicitly for m68k.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-43-peter.maydell@linaro.org
+---
+ target/m68k/cpu.c              | 2 ++
+ fpu/softfloat-specialize.c.inc | 2 +-
+files changed, 3 insertions(+), 1 deletion(-)
+diff --git a/target/m68k/cpu.c b/target/m68k/cpu.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/m68k/cpu.c
++++ b/target/m68k/cpu.c
+@@ -XXX,XX +XXX,XX @@ static void m68k_cpu_reset_hold(Object *obj, ResetType type)
+      * preceding paragraph for nonsignaling NaNs.
+      */
+     set_float_2nan_prop_rule(float_2nan_prop_ab, &env->fp_status);
++    /* Default NaN: sign bit clear, all frac bits set */
++    set_float_default_nan_pattern(0b01111111, &env->fp_status);
+     nan = floatx80_default_nan(&env->fp_status);
+     for (i = 0; i < 8; i++) {
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
+index XXXXXXX..XXXXXXX 100644
+--- a/fpu/softfloat-specialize.c.inc
++++ b/fpu/softfloat-specialize.c.inc
+@@ -XXX,XX +XXX,XX @@ static void parts64_default_nan(FloatParts64 *p, float_status *status)
+     uint8_t dnan_pattern = status->default_nan_pattern;
+     if (dnan_pattern == 0) {
+-#if defined(TARGET_SPARC) || defined(TARGET_M68K)
++#if defined(TARGET_SPARC)
+         /* Sign bit clear, all frac bits set */
+         dnan_pattern = 0b01111111;
+ #elif defined(TARGET_HEXAGON)
+--
+.34.1

-[PULL 38/57] target/arm: Implement helper_mte_checkN
+[PULL 49/72] target/mips: Set default NaN pattern explicitly
-From: Richard Henderson <richard.henderson@linaro.org>
+Set the default NaN pattern explicitly for MIPS. Note that this
 is our only target which currently changes the default NaN
 at runtime (which it was previously doing indirectly when it
 changed the snan_bit_is_one setting).
-Fill out the stub that was added earlier.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20241202131347.498124-44-peter.maydell@linaro.org
 ---
  target/mips/fpu_helper.h | 7 +++++++
  target/mips/msa.c        | 3 +++
 files changed, 10 insertions(+)
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+diff --git a/target/mips/fpu_helper.h b/target/mips/fpu_helper.h
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20200626033144.790098-27-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/internals.h  |   2 +
  target/arm/mte_helper.c | 165 +++++++++++++++++++++++++++++++++++++++-
 files changed, 166 insertions(+), 1 deletion(-)
 diff --git a/target/arm/internals.h b/target/arm/internals.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/internals.h
+--- a/target/mips/fpu_helper.h
-+++ b/target/arm/internals.h
++++ b/target/mips/fpu_helper.h
-@@ -XXX,XX +XXX,XX @@ FIELD(MTEDESC, TSIZE, 14, 10)  /* mte_checkN only */
+@@ -XXX,XX +XXX,XX @@ static inline void restore_snan_bit_mode(CPUMIPSState *env)
- bool mte_probe1(CPUARMState *env, uint32_t desc, uint64_t ptr);
+     set_float_infzeronan_rule(izn_rule, &env->active_fpu.fp_status);
- uint64_t mte_check1(CPUARMState *env, uint32_t desc,
+     nan3_rule = nan2008 ? float_3nan_prop_s_cab : float_3nan_prop_s_abc;
-                     uint64_t ptr, uintptr_t ra);
+     set_float_3nan_prop_rule(nan3_rule, &env->active_fpu.fp_status);
-+uint64_t mte_checkN(CPUARMState *env, uint32_t desc,
++    /*
-+                    uint64_t ptr, uintptr_t ra);
++     * With nan2008, the default NaN value has the sign bit clear and the
++     * frac msb set; with the older mode, the sign bit is clear, and all
- static inline int allocation_tag_from_addr(uint64_t ptr)
++     * frac bits except the msb are set.
- {
++     */
-diff --git a/target/arm/mte_helper.c b/target/arm/mte_helper.c
++    set_float_default_nan_pattern(nan2008 ? 0b01000000 : 0b00111111,
 +                                  &env->active_fpu.fp_status);
  }
 diff --git a/target/mips/msa.c b/target/mips/msa.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/mte_helper.c
+--- a/target/mips/msa.c
-+++ b/target/arm/mte_helper.c
++++ b/target/mips/msa.c
-@@ -XXX,XX +XXX,XX @@ uint64_t HELPER(mte_check1)(CPUARMState *env, uint32_t desc, uint64_t ptr)
+@@ -XXX,XX +XXX,XX @@ void msa_reset(CPUMIPSState *env)
- /*
+     /* Inf * 0 + NaN returns the input NaN */
-  * Perform an MTE checked access for multiple logical accesses.
+     set_float_infzeronan_rule(float_infzeronan_dnan_never,
-  */
+                               &env->active_tc.msa_fp_status);
-+
++    /* Default NaN: sign bit clear, frac msb set */
-+/**
++    set_float_default_nan_pattern(0b01000000,
-+ * checkN:
++                                  &env->active_tc.msa_fp_status);
 + * @tag: tag memory to test
 + * @odd: true to begin testing at tags at odd nibble
 + * @cmp: the tag to compare against
 + * @count: number of tags to test
 + *
 + * Return the number of successful tests.
 + * Thus a return value < @count indicates a failure.
 + *
 + * A note about sizes: count is expected to be small.
 + *
 + * The most common use will be LDP/STP of two integer registers,
 + * which means 16 bytes of memory touching at most 2 tags, but
 + * often the access is aligned and thus just 1 tag.
 + *
 + * Using AdvSIMD LD/ST (multiple), one can access 64 bytes of memory,
 + * touching at most 5 tags.  SVE LDR/STR (vector) with the default
 + * vector length is also 64 bytes; the maximum architectural length
 + * is 256 bytes touching at most 9 tags.
 + *
 + * The loop below uses 7 logical operations and 1 memory operation
 + * per tag pair.  An implementation that loads an aligned word and
 + * uses masking to ignore adjacent tags requires 18 logical operations
 + * and thus does not begin to pay off until 6 tags.
 + * Which, according to the survey above, is unlikely to be common.
 + */
 +static int checkN(uint8_t *mem, int odd, int cmp, int count)
 +{
 +    int n = 0, diff;
 +
 +    /* Replicate the test tag and compare.  */
 +    cmp *= 0x11;
 +    diff = *mem++ ^ cmp;
 +
 +    if (odd) {
 +        goto start_odd;
 +    }
 +
 +    while (1) {
 +        /* Test even tag. */
 +        if (unlikely((diff) & 0x0f)) {
 +            break;
 +        }
 +        if (++n == count) {
 +            break;
 +        }
 +
 +    start_odd:
 +        /* Test odd tag. */
 +        if (unlikely((diff) & 0xf0)) {
 +            break;
 +        }
 +        if (++n == count) {
 +            break;
 +        }
 +
 +        diff = *mem++ ^ cmp;
 +    }
 +    return n;
 +}
 +
 +uint64_t mte_checkN(CPUARMState *env, uint32_t desc,
 +                    uint64_t ptr, uintptr_t ra)
 +{
 +    int mmu_idx, ptr_tag, bit55;
 +    uint64_t ptr_last, ptr_end, prev_page, next_page;
 +    uint64_t tag_first, tag_end;
 +    uint64_t tag_byte_first, tag_byte_end;
 +    uint32_t esize, total, tag_count, tag_size, n, c;
 +    uint8_t *mem1, *mem2;
 +    MMUAccessType type;
 +
 +    bit55 = extract64(ptr, 55, 1);
 +
 +    /* If TBI is disabled, the access is unchecked, and ptr is not dirty. */
 +    if (unlikely(!tbi_check(desc, bit55))) {
 +        return ptr;
 +    }
 +
 +    ptr_tag = allocation_tag_from_addr(ptr);
 +
 +    if (tcma_check(desc, bit55, ptr_tag)) {
 +        goto done;
 +    }
 +
 +    mmu_idx = FIELD_EX32(desc, MTEDESC, MIDX);
 +    type = FIELD_EX32(desc, MTEDESC, WRITE) ? MMU_DATA_STORE : MMU_DATA_LOAD;
 +    esize = FIELD_EX32(desc, MTEDESC, ESIZE);
 +    total = FIELD_EX32(desc, MTEDESC, TSIZE);
 +
 +    /* Find the addr of the end of the access, and of the last element. */
 +    ptr_end = ptr + total;
 +    ptr_last = ptr_end - esize;
 +
 +    /* Round the bounds to the tag granule, and compute the number of tags. */
 +    tag_first = QEMU_ALIGN_DOWN(ptr, TAG_GRANULE);
 +    tag_end = QEMU_ALIGN_UP(ptr_last, TAG_GRANULE);
 +    tag_count = (tag_end - tag_first) / TAG_GRANULE;
 +
 +    /* Round the bounds to twice the tag granule, and compute the bytes. */
 +    tag_byte_first = QEMU_ALIGN_DOWN(ptr, 2 * TAG_GRANULE);
 +    tag_byte_end = QEMU_ALIGN_UP(ptr_last, 2 * TAG_GRANULE);
 +
 +    /* Locate the page boundaries. */
 +    prev_page = ptr & TARGET_PAGE_MASK;
 +    next_page = prev_page + TARGET_PAGE_SIZE;
 +
 +    if (likely(tag_end - prev_page <= TARGET_PAGE_SIZE)) {
 +        /* Memory access stays on one page. */
 +        tag_size = (tag_byte_end - tag_byte_first) / (2 * TAG_GRANULE);
 +        mem1 = allocation_tag_mem(env, mmu_idx, ptr, type, total,
 +                                  MMU_DATA_LOAD, tag_size, ra);
 +        if (!mem1) {
 +            goto done;
 +        }
 +        /* Perform all of the comparisons. */
 +        n = checkN(mem1, ptr & TAG_GRANULE, ptr_tag, tag_count);
 +    } else {
 +        /* Memory access crosses to next page. */
 +        tag_size = (next_page - tag_byte_first) / (2 * TAG_GRANULE);
 +        mem1 = allocation_tag_mem(env, mmu_idx, ptr, type, next_page - ptr,
 +                                  MMU_DATA_LOAD, tag_size, ra);
 +
 +        tag_size = (tag_byte_end - next_page) / (2 * TAG_GRANULE);
 +        mem2 = allocation_tag_mem(env, mmu_idx, next_page, type,
 +                                  ptr_end - next_page,
 +                                  MMU_DATA_LOAD, tag_size, ra);
 +
 +        /*
 +         * Perform all of the comparisons.
 +         * Note the possible but unlikely case of the operation spanning
 +         * two pages that do not both have tagging enabled.
 +         */
 +        n = c = (next_page - tag_first) / TAG_GRANULE;
 +        if (mem1) {
 +            n = checkN(mem1, ptr & TAG_GRANULE, ptr_tag, c);
 +        }
 +        if (n == c) {
 +            if (!mem2) {
 +                goto done;
 +            }
 +            n += checkN(mem2, 0, ptr_tag, tag_count - c);
 +        }
 +    }
 +
 +    /*
 +     * If we failed, we know which granule.  Compute the element that
 +     * is first in that granule, and signal failure on that element.
 +     */
 +    if (unlikely(n < tag_count)) {
 +        uint64_t fail_ofs;
 +
 +        fail_ofs = tag_first + n * TAG_GRANULE - ptr;
 +        fail_ofs = ROUND_UP(fail_ofs, esize);
 +        mte_check_fail(env, mmu_idx, ptr + fail_ofs, ra);
 +    }
 +
 + done:
 +    return useronly_clean_ptr(ptr);
 +}
 +
  uint64_t HELPER(mte_checkN)(CPUARMState *env, uint32_t desc, uint64_t ptr)
  {
 -    return ptr;
 +    return mte_checkN(env, desc, ptr, GETPC());
  }
 --
-.20.1
+.34.1

-New patch
+[PULL 50/72] target/openrisc: Set default NaN pattern explicitly
+Set the default NaN pattern explicitly for openrisc.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-45-peter.maydell@linaro.org
+---
+ target/openrisc/cpu.c | 2 ++
+file changed, 2 insertions(+)
+diff --git a/target/openrisc/cpu.c b/target/openrisc/cpu.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/openrisc/cpu.c
++++ b/target/openrisc/cpu.c
+@@ -XXX,XX +XXX,XX @@ static void openrisc_cpu_reset_hold(Object *obj, ResetType type)
+      */
+     set_float_2nan_prop_rule(float_2nan_prop_x87, &cpu->env.fp_status);
++    /* Default NaN: sign bit clear, frac msb set */
++    set_float_default_nan_pattern(0b01000000, &cpu->env.fp_status);
+ #ifndef CONFIG_USER_ONLY
+     cpu->env.picmr = 0x00000000;
+--
+.34.1

-[PULL 32/57] target/arm: Implement the access tag cache flushes
+[PULL 51/72] target/ppc: Set default NaN pattern explicitly
-From: Richard Henderson <richard.henderson@linaro.org>
+Set the default NaN pattern explicitly for ppc.
-Like the regular data cache flushes, these are nops within qemu.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20241202131347.498124-46-peter.maydell@linaro.org
 ---
  target/ppc/cpu_init.c | 4 ++++
 file changed, 4 insertions(+)
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+diff --git a/target/ppc/cpu_init.c b/target/ppc/cpu_init.c
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20200626033144.790098-21-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/helper.c | 65 +++++++++++++++++++++++++++++++++++++++++++++
 file changed, 65 insertions(+)
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/target/ppc/cpu_init.c
-+++ b/target/arm/helper.c
++++ b/target/ppc/cpu_init.c
-@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo mte_reginfo[] = {
+@@ -XXX,XX +XXX,XX @@ static void ppc_cpu_reset_hold(Object *obj, ResetType type)
-       .opc0 = 3, .opc1 = 3, .crn = 4, .crm = 2, .opc2 = 7,
+     set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
-       .type = ARM_CP_NO_RAW,
+     set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->vec_status);
-       .access = PL0_RW, .readfn = tco_read, .writefn = tco_write },
-+    { .name = "DC_IGVAC", .state = ARM_CP_STATE_AA64,
++    /* Default NaN: sign bit clear, set frac msb */
-+      .opc0 = 1, .opc1 = 0, .crn = 7, .crm = 6, .opc2 = 3,
++    set_float_default_nan_pattern(0b01000000, &env->fp_status);
-+      .type = ARM_CP_NOP, .access = PL1_W,
++    set_float_default_nan_pattern(0b01000000, &env->vec_status);
 +      .accessfn = aa64_cacheop_poc_access },
 +    { .name = "DC_IGSW", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 1, .opc1 = 0, .crn = 7, .crm = 6, .opc2 = 4,
 +      .type = ARM_CP_NOP, .access = PL1_W, .accessfn = access_tsw },
 +    { .name = "DC_IGDVAC", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 1, .opc1 = 0, .crn = 7, .crm = 6, .opc2 = 5,
 +      .type = ARM_CP_NOP, .access = PL1_W,
 +      .accessfn = aa64_cacheop_poc_access },
 +    { .name = "DC_IGDSW", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 1, .opc1 = 0, .crn = 7, .crm = 6, .opc2 = 6,
 +      .type = ARM_CP_NOP, .access = PL1_W, .accessfn = access_tsw },
 +    { .name = "DC_CGSW", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 1, .opc1 = 0, .crn = 7, .crm = 10, .opc2 = 4,
 +      .type = ARM_CP_NOP, .access = PL1_W, .accessfn = access_tsw },
 +    { .name = "DC_CGDSW", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 1, .opc1 = 0, .crn = 7, .crm = 10, .opc2 = 6,
 +      .type = ARM_CP_NOP, .access = PL1_W, .accessfn = access_tsw },
 +    { .name = "DC_CIGSW", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 1, .opc1 = 0, .crn = 7, .crm = 14, .opc2 = 4,
 +      .type = ARM_CP_NOP, .access = PL1_W, .accessfn = access_tsw },
 +    { .name = "DC_CIGDSW", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 1, .opc1 = 0, .crn = 7, .crm = 14, .opc2 = 6,
 +      .type = ARM_CP_NOP, .access = PL1_W, .accessfn = access_tsw },
      REGINFO_SENTINEL
  };
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo mte_tco_ro_reginfo[] = {
        .type = ARM_CP_CONST, .access = PL0_RW, },
      REGINFO_SENTINEL
  };
 +
-+static const ARMCPRegInfo mte_el0_cacheop_reginfo[] = {
+     for (i = 0; i < ARRAY_SIZE(env->spr_cb); i++) {
-+    { .name = "DC_CGVAC", .state = ARM_CP_STATE_AA64,
+         ppc_spr_t *spr = &env->spr_cb[i];
 +      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 10, .opc2 = 3,
 +      .type = ARM_CP_NOP, .access = PL0_W,
 +      .accessfn = aa64_cacheop_poc_access },
 +    { .name = "DC_CGDVAC", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 10, .opc2 = 5,
 +      .type = ARM_CP_NOP, .access = PL0_W,
 +      .accessfn = aa64_cacheop_poc_access },
 +    { .name = "DC_CGVAP", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 12, .opc2 = 3,
 +      .type = ARM_CP_NOP, .access = PL0_W,
 +      .accessfn = aa64_cacheop_poc_access },
 +    { .name = "DC_CGDVAP", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 12, .opc2 = 5,
 +      .type = ARM_CP_NOP, .access = PL0_W,
 +      .accessfn = aa64_cacheop_poc_access },
 +    { .name = "DC_CGVADP", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 13, .opc2 = 3,
 +      .type = ARM_CP_NOP, .access = PL0_W,
 +      .accessfn = aa64_cacheop_poc_access },
 +    { .name = "DC_CGDVADP", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 13, .opc2 = 5,
 +      .type = ARM_CP_NOP, .access = PL0_W,
 +      .accessfn = aa64_cacheop_poc_access },
 +    { .name = "DC_CIGVAC", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 14, .opc2 = 3,
 +      .type = ARM_CP_NOP, .access = PL0_W,
 +      .accessfn = aa64_cacheop_poc_access },
 +    { .name = "DC_CIGDVAC", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 14, .opc2 = 5,
 +      .type = ARM_CP_NOP, .access = PL0_W,
 +      .accessfn = aa64_cacheop_poc_access },
 +    REGINFO_SENTINEL
 +};
 +
  #endif
  static CPAccessResult access_predinv(CPUARMState *env, const ARMCPRegInfo *ri,
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
       */
      if (cpu_isar_feature(aa64_mte, cpu)) {
          define_arm_cp_regs(cpu, mte_reginfo);
 +        define_arm_cp_regs(cpu, mte_el0_cacheop_reginfo);
      } else if (cpu_isar_feature(aa64_mte_insn_reg, cpu)) {
          define_arm_cp_regs(cpu, mte_tco_ro_reginfo);
 +        define_arm_cp_regs(cpu, mte_el0_cacheop_reginfo);
      }
  #endif
 --
-.20.1
+.34.1

-[PULL 12/57] hw/misc/pca9552: Model qdev output GPIOs
+[PULL 52/72] target/sh4: Set default NaN pattern explicitly
-From: Philippe Mathieu-Daudé <f4bug@amsat.org>
+Set the default NaN pattern explicitly for sh4. Note that sh4
 is one of the only three targets (the others being HPPA and
 sometimes MIPS) that has snan_bit_is_one set.
-The PCA9552 has 16 GPIOs which can be used as input,
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-output or PWM mode. QEMU models the output GPIO with
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-the qemu_irq type. Let the device expose the 16 GPIOs
+Message-id: 20241202131347.498124-47-peter.maydell@linaro.org
-to allow us to later connect LEDs to these outputs.
+---
  target/sh4/cpu.c | 2 ++
 file changed, 2 insertions(+)
-Reviewed-by: Cédric Le Goater <clg@kaod.org>
+diff --git a/target/sh4/cpu.c b/target/sh4/cpu.c
 Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
 Tested-by: Cédric Le Goater <clg@kaod.org>
 Message-id: 20200623072723.6324-10-f4bug@amsat.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  include/hw/misc/pca9552.h | 1 +
  hw/misc/pca9552.c         | 6 ++++++
 files changed, 7 insertions(+)
 diff --git a/include/hw/misc/pca9552.h b/include/hw/misc/pca9552.h
 index XXXXXXX..XXXXXXX 100644
---- a/include/hw/misc/pca9552.h
+--- a/target/sh4/cpu.c
-+++ b/include/hw/misc/pca9552.h
++++ b/target/sh4/cpu.c
-@@ -XXX,XX +XXX,XX @@ typedef struct PCA955xState {
+@@ -XXX,XX +XXX,XX @@ static void superh_cpu_reset_hold(Object *obj, ResetType type)
-     uint8_t pointer;
+     set_flush_to_zero(1, &env->fp_status);
+ #endif
-     uint8_t regs[PCA955X_NR_REGS];
+     set_default_nan_mode(1, &env->fp_status);
-+    qemu_irq gpio[PCA955X_PIN_COUNT_MAX];
++    /* sign bit clear, set all frac bits other than msb */
-     char *description; /* For debugging purpose only */
++    set_float_default_nan_pattern(0b00111111, &env->fp_status);
  } PCA955xState;
 diff --git a/hw/misc/pca9552.c b/hw/misc/pca9552.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/misc/pca9552.c
 +++ b/hw/misc/pca9552.c
@@ -XXX,XX +XXX,XX @@
  #include "hw/qdev-properties.h"
  #include "hw/misc/pca9552.h"
  #include "hw/misc/pca9552_regs.h"
 +#include "hw/irq.h"
  #include "migration/vmstate.h"
  #include "qapi/error.h"
  #include "qapi/visitor.h"
@@ -XXX,XX +XXX,XX @@ static void pca955x_update_pin_input(PCA955xState *s)
          switch (config) {
          case PCA9552_LED_ON:
 +            qemu_set_irq(s->gpio[i], 1);
              s->regs[input_reg] |= 1 << input_shift;
              break;
          case PCA9552_LED_OFF:
 +            qemu_set_irq(s->gpio[i], 0);
              s->regs[input_reg] &= ~(1 << input_shift);
              break;
          case PCA9552_LED_PWM0:
@@ -XXX,XX +XXX,XX @@ static void pca955x_initfn(Object *obj)
  static void pca955x_realize(DeviceState *dev, Error **errp)
  {
 +    PCA955xClass *k = PCA955X_GET_CLASS(dev);
      PCA955xState *s = PCA955X(dev);
      if (!s->description) {
          s->description = g_strdup("pca-unspecified");
      }
 +
 +    qdev_init_gpio_out(dev, s->gpio, k->pin_count);
  }
- static Property pca955x_properties[] = {
+ static void superh_cpu_disas_set_info(CPUState *cpu, disassemble_info *info)
 --
-.20.1
+.34.1

-[PULL 08/57] hw/misc/pca9552: Add a 'description' property for debugging purpose
+[PULL 53/72] target/rx: Set default NaN pattern explicitly
-From: Philippe Mathieu-Daudé <f4bug@amsat.org>
+Set the default NaN pattern explicitly for rx.
-Add a description field to distinguish between multiple devices.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20241202131347.498124-48-peter.maydell@linaro.org
 ---
  target/rx/cpu.c | 2 ++
 file changed, 2 insertions(+)
-Reviewed-by: Cédric Le Goater <clg@kaod.org>
+diff --git a/target/rx/cpu.c b/target/rx/cpu.c
 Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
 Tested-by: Cédric Le Goater <clg@kaod.org>
 Message-id: 20200623072723.6324-6-f4bug@amsat.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  include/hw/misc/pca9552.h |  1 +
  hw/misc/pca9552.c         | 18 ++++++++++++++++++
 files changed, 19 insertions(+)
 diff --git a/include/hw/misc/pca9552.h b/include/hw/misc/pca9552.h
 index XXXXXXX..XXXXXXX 100644
---- a/include/hw/misc/pca9552.h
+--- a/target/rx/cpu.c
-+++ b/include/hw/misc/pca9552.h
++++ b/target/rx/cpu.c
-@@ -XXX,XX +XXX,XX @@ typedef struct PCA955xState {
+@@ -XXX,XX +XXX,XX @@ static void rx_cpu_reset_hold(Object *obj, ResetType type)
-     uint8_t pointer;
+      * then prefer dest over source", which is float_2nan_prop_s_ab.
+      */
-     uint8_t regs[PCA955X_NR_REGS];
+     set_float_2nan_prop_rule(float_2nan_prop_x87, &env->fp_status);
-+    char *description; /* For debugging purpose only */
++    /* Default NaN value: sign bit clear, set frac msb */
- } PCA955xState;
++    set_float_default_nan_pattern(0b01000000, &env->fp_status);
  #endif
 diff --git a/hw/misc/pca9552.c b/hw/misc/pca9552.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/misc/pca9552.c
 +++ b/hw/misc/pca9552.c
@@ -XXX,XX +XXX,XX @@
  #include "qemu/osdep.h"
  #include "qemu/log.h"
  #include "qemu/module.h"
 +#include "hw/qdev-properties.h"
  #include "hw/misc/pca9552.h"
  #include "hw/misc/pca9552_regs.h"
  #include "migration/vmstate.h"
@@ -XXX,XX +XXX,XX @@ static void pca955x_initfn(Object *obj)
      }
  }
-+static void pca955x_realize(DeviceState *dev, Error **errp)
+ static ObjectClass *rx_cpu_class_by_name(const char *cpu_model)
 +{
 +    PCA955xState *s = PCA955X(dev);
 +
 +    if (!s->description) {
 +        s->description = g_strdup("pca-unspecified");
 +    }
 +}
 +
 +static Property pca955x_properties[] = {
 +    DEFINE_PROP_STRING("description", PCA955xState, description),
 +    DEFINE_PROP_END_OF_LIST(),
 +};
 +
  static void pca955x_class_init(ObjectClass *klass, void *data)
  {
 +    DeviceClass *dc = DEVICE_CLASS(klass);
      I2CSlaveClass *k = I2C_SLAVE_CLASS(klass);
      k->event = pca955x_event;
      k->recv = pca955x_recv;
      k->send = pca955x_send;
 +    dc->realize = pca955x_realize;
 +    device_class_set_props(dc, pca955x_properties);
  }
  static const TypeInfo pca955x_info = {
 --
-.20.1
+.34.1

-New patch
+[PULL 54/72] target/s390x: Set default NaN pattern explicitly
+Set the default NaN pattern explicitly for s390x.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-49-peter.maydell@linaro.org
+---
+ target/s390x/cpu.c | 2 ++
+file changed, 2 insertions(+)
+diff --git a/target/s390x/cpu.c b/target/s390x/cpu.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/s390x/cpu.c
++++ b/target/s390x/cpu.c
+@@ -XXX,XX +XXX,XX @@ static void s390_cpu_reset_hold(Object *obj, ResetType type)
+         set_float_3nan_prop_rule(float_3nan_prop_s_abc, &env->fpu_status);
+         set_float_infzeronan_rule(float_infzeronan_dnan_always,
+                                   &env->fpu_status);
++        /* Default NaN value: sign bit clear, frac msb set */
++        set_float_default_nan_pattern(0b01000000, &env->fpu_status);
+        /* fall through */
+     case RESET_TYPE_S390_CPU_NORMAL:
+         env->psw.mask &= ~PSW_MASK_RI;
+--
+.34.1

-New patch
+[PULL 55/72] target/sparc: Set default NaN pattern explicitly
+Set the default NaN pattern explicitly for SPARC, and remove
+the ifdef from parts64_default_nan.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-50-peter.maydell@linaro.org
+---
+ target/sparc/cpu.c             | 2 ++
+ fpu/softfloat-specialize.c.inc | 5 +----
+files changed, 3 insertions(+), 4 deletions(-)
+diff --git a/target/sparc/cpu.c b/target/sparc/cpu.c
+index XXXXXXX..XXXXXXX 100644
+--- a/target/sparc/cpu.c
++++ b/target/sparc/cpu.c
+@@ -XXX,XX +XXX,XX @@ static void sparc_cpu_realizefn(DeviceState *dev, Error **errp)
+     set_float_3nan_prop_rule(float_3nan_prop_s_cba, &env->fp_status);
+     /* For inf * 0 + NaN, return the input NaN */
+     set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
++    /* Default NaN value: sign bit clear, all frac bits set */
++    set_float_default_nan_pattern(0b01111111, &env->fp_status);
+     cpu_exec_realizefn(cs, &local_err);
+     if (local_err != NULL) {
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
+index XXXXXXX..XXXXXXX 100644
+--- a/fpu/softfloat-specialize.c.inc
++++ b/fpu/softfloat-specialize.c.inc
+@@ -XXX,XX +XXX,XX @@ static void parts64_default_nan(FloatParts64 *p, float_status *status)
+     uint8_t dnan_pattern = status->default_nan_pattern;
+     if (dnan_pattern == 0) {
+-#if defined(TARGET_SPARC)
+-        /* Sign bit clear, all frac bits set */
+-        dnan_pattern = 0b01111111;
+-#elif defined(TARGET_HEXAGON)
++#if defined(TARGET_HEXAGON)
+         /* Sign bit set, all frac bits set. */
+         dnan_pattern = 0b11111111;
+ #else
+--
+.34.1

-[PULL 04/57] hw/i2c/core: Add i2c_try_create_slave() and i2c_realize_and_unref()
+[PULL 56/72] target/xtensa: Set default NaN pattern explicitly
-From: Philippe Mathieu-Daudé <f4bug@amsat.org>
+Set the default NaN pattern explicitly for xtensa.
-Extract i2c_try_create_slave() and i2c_realize_and_unref()
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-from i2c_create_slave().
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-We can now set properties on a I2CSlave before it is realized.
+Message-id: 20241202131347.498124-51-peter.maydell@linaro.org
 ---
  target/xtensa/cpu.c | 2 ++
 file changed, 2 insertions(+)
-This is in line with the recent qdev/QOM changes merged
+diff --git a/target/xtensa/cpu.c b/target/xtensa/cpu.c
 in commit 6675a653d2e.
 Reviewed-by: Corey Minyard <cminyard@mvista.com>
 Reviewed-by: Cédric Le Goater <clg@kaod.org>
 Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
 Reviewed-by: Markus Armbruster <armbru@redhat.com>
 Tested-by: Cédric Le Goater <clg@kaod.org>
 Message-id: 20200623072723.6324-2-f4bug@amsat.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  include/hw/i2c/i2c.h |  2 ++
  hw/i2c/core.c        | 18 ++++++++++++++++--
 files changed, 18 insertions(+), 2 deletions(-)
 diff --git a/include/hw/i2c/i2c.h b/include/hw/i2c/i2c.h
 index XXXXXXX..XXXXXXX 100644
---- a/include/hw/i2c/i2c.h
+--- a/target/xtensa/cpu.c
-+++ b/include/hw/i2c/i2c.h
++++ b/target/xtensa/cpu.c
-@@ -XXX,XX +XXX,XX @@ int i2c_send(I2CBus *bus, uint8_t data);
+@@ -XXX,XX +XXX,XX @@ static void xtensa_cpu_reset_hold(Object *obj, ResetType type)
- uint8_t i2c_recv(I2CBus *bus);
+     /* For inf * 0 + NaN, return the input NaN */
+     set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
- DeviceState *i2c_create_slave(I2CBus *bus, const char *name, uint8_t addr);
+     set_no_signaling_nans(!dfpu, &env->fp_status);
-+DeviceState *i2c_try_create_slave(const char *name, uint8_t addr);
++    /* Default NaN value: sign bit clear, set frac msb */
-+bool i2c_realize_and_unref(DeviceState *dev, I2CBus *bus, Error **errp);
++    set_float_default_nan_pattern(0b01000000, &env->fp_status);
+     xtensa_use_first_nan(env, !dfpu);
  /* lm832x.c */
  void lm832x_key_event(DeviceState *dev, int key, int state);
 diff --git a/hw/i2c/core.c b/hw/i2c/core.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/i2c/core.c
 +++ b/hw/i2c/core.c
@@ -XXX,XX +XXX,XX @@ const VMStateDescription vmstate_i2c_slave = {
      }
  };
 -DeviceState *i2c_create_slave(I2CBus *bus, const char *name, uint8_t addr)
 +DeviceState *i2c_try_create_slave(const char *name, uint8_t addr)
  {
      DeviceState *dev;
      dev = qdev_new(name);
      qdev_prop_set_uint8(dev, "address", addr);
 -    qdev_realize_and_unref(dev, &bus->qbus, &error_fatal);
 +    return dev;
 +}
 +
 +bool i2c_realize_and_unref(DeviceState *dev, I2CBus *bus, Error **errp)
 +{
 +    return qdev_realize_and_unref(dev, &bus->qbus, errp);
 +}
 +
 +DeviceState *i2c_create_slave(I2CBus *bus, const char *name, uint8_t addr)
 +{
 +    DeviceState *dev;
 +
 +    dev = i2c_try_create_slave(name, addr);
 +    i2c_realize_and_unref(dev, bus, &error_fatal);
 +
      return dev;
  }
 --
-.20.1
+.34.1

-[PULL 07/57] hw/misc/pca9552: Add generic PCA955xClass, parent of TYPE_PCA9552
+[PULL 57/72] target/hexagon: Set default NaN pattern explicitly
-From: Philippe Mathieu-Daudé <f4bug@amsat.org>
+Set the default NaN pattern explicitly for hexagon.
 Remove the ifdef from parts64_default_nan(); the only
 remaining unconverted targets all use the default case.
-Extract the code common to the PCA955x family in PCA955xClass,
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-keeping the PCA9552 specific parts into pca9552_class_init().
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Remove the 'TODO' comment added in commit 5141d4158cf.
+Message-id: 20241202131347.498124-52-peter.maydell@linaro.org
 ---
  target/hexagon/cpu.c           | 2 ++
  fpu/softfloat-specialize.c.inc | 5 -----
 files changed, 2 insertions(+), 5 deletions(-)
-Suggested-by: Cédric Le Goater <clg@kaod.org>
+diff --git a/target/hexagon/cpu.c b/target/hexagon/cpu.c
 Reviewed-by: Cédric Le Goater <clg@kaod.org>
 Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
 Tested-by: Cédric Le Goater <clg@kaod.org>
 Message-id: 20200623072723.6324-5-f4bug@amsat.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  include/hw/misc/pca9552.h |  6 ++--
  hw/misc/pca9552.c         | 66 ++++++++++++++++++++++++++++-----------
 files changed, 51 insertions(+), 21 deletions(-)
 diff --git a/include/hw/misc/pca9552.h b/include/hw/misc/pca9552.h
 index XXXXXXX..XXXXXXX 100644
---- a/include/hw/misc/pca9552.h
+--- a/target/hexagon/cpu.c
-+++ b/include/hw/misc/pca9552.h
++++ b/target/hexagon/cpu.c
-@@ -XXX,XX +XXX,XX @@
+@@ -XXX,XX +XXX,XX @@ static void hexagon_cpu_reset_hold(Object *obj, ResetType type)
- #include "hw/i2c/i2c.h"
+     set_default_nan_mode(1, &env->fp_status);
- #define TYPE_PCA9552 "pca9552"
+     set_float_detect_tininess(float_tininess_before_rounding, &env->fp_status);
--#define PCA955X(obj) OBJECT_CHECK(PCA955xState, (obj), TYPE_PCA9552)
++    /* Default NaN value: sign bit set, all frac bits set */
-+#define TYPE_PCA955X "pca955x"
++    set_float_default_nan_pattern(0b11111111, &env->fp_status);
-+#define PCA955X(obj) OBJECT_CHECK(PCA955xState, (obj), TYPE_PCA955X)
+ }
- #define PCA955X_NR_REGS 10
+ static void hexagon_cpu_disas_set_info(CPUState *s, disassemble_info *info)
-+#define PCA955X_PIN_COUNT_MAX 16
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
  typedef struct PCA955xState {
      /*< private >*/
@@ -XXX,XX +XXX,XX @@ typedef struct PCA955xState {
      uint8_t pointer;
      uint8_t regs[PCA955X_NR_REGS];
 -    uint8_t max_reg;
 -    uint8_t pin_count;
  } PCA955xState;
  #endif
 diff --git a/hw/misc/pca9552.c b/hw/misc/pca9552.c
 index XXXXXXX..XXXXXXX 100644
---- a/hw/misc/pca9552.c
+--- a/fpu/softfloat-specialize.c.inc
-+++ b/hw/misc/pca9552.c
++++ b/fpu/softfloat-specialize.c.inc
-@@ -XXX,XX +XXX,XX @@
+@@ -XXX,XX +XXX,XX @@ static void parts64_default_nan(FloatParts64 *p, float_status *status)
-  *     https://www.nxp.com/docs/en/application-note/AN264.pdf
+     uint8_t dnan_pattern = status->default_nan_pattern;
-  *
-  * Copyright (c) 2017-2018, IBM Corporation.
+     if (dnan_pattern == 0) {
-+ * Copyright (c) 2020 Philippe Mathieu-Daudé
+-#if defined(TARGET_HEXAGON)
-  *
+-        /* Sign bit set, all frac bits set. */
-  * This work is licensed under the terms of the GNU GPL, version 2 or
+-        dnan_pattern = 0b11111111;
-  * later. See the COPYING file in the top-level directory.
+-#else
-@@ -XXX,XX +XXX,XX @@
+         /*
- #include "qapi/error.h"
+          * This case is true for Alpha, ARM, MIPS, OpenRISC, PPC, RISC-V,
- #include "qapi/visitor.h"
+          * S390, SH4, TriCore, and Xtensa.  Our other supported targets
+@@ -XXX,XX +XXX,XX @@ static void parts64_default_nan(FloatParts64 *p, float_status *status)
-+typedef struct PCA955xClass {
+             /* sign bit clear, set frac msb */
-+    /*< private >*/
+             dnan_pattern = 0b01000000;
-+    I2CSlaveClass parent_class;
+         }
-+    /*< public >*/
+-#endif
 +
 +    uint8_t pin_count;
 +    uint8_t max_reg;
 +} PCA955xClass;
 +
 +#define PCA955X_CLASS(klass) \
 +    OBJECT_CLASS_CHECK(PCA955xClass, (klass), TYPE_PCA955X)
 +#define PCA955X_GET_CLASS(obj) \
 +    OBJECT_GET_CLASS(PCA955xClass, (obj), TYPE_PCA955X)
 +
  #define PCA9552_LED_ON   0x0
  #define PCA9552_LED_OFF  0x1
  #define PCA9552_LED_PWM0 0x2
@@ -XXX,XX +XXX,XX @@ static uint8_t pca955x_pin_get_config(PCA955xState *s, int pin)
  static void pca955x_update_pin_input(PCA955xState *s)
  {
 +    PCA955xClass *k = PCA955X_GET_CLASS(s);
      int i;
 -    for (i = 0; i < s->pin_count; i++) {
 +    for (i = 0; i < k->pin_count; i++) {
          uint8_t input_reg = PCA9552_INPUT0 + (i / 8);
          uint8_t input_shift = (i % 8);
          uint8_t config = pca955x_pin_get_config(s, i);
@@ -XXX,XX +XXX,XX @@ static void pca955x_write(PCA955xState *s, uint8_t reg, uint8_t data)
   */
  static void pca955x_autoinc(PCA955xState *s)
  {
 +    PCA955xClass *k = PCA955X_GET_CLASS(s);
 +
      if (s->pointer != 0xFF && s->pointer & PCA9552_AUTOINC) {
          uint8_t reg = s->pointer & 0xf;
 -        reg = (reg + 1) % (s->max_reg + 1);
 +        reg = (reg + 1) % (k->max_reg + 1);
          s->pointer = reg | PCA9552_AUTOINC;
      }
- }
+     assert(dnan_pattern != 0);
@@ -XXX,XX +XXX,XX @@ static int pca955x_event(I2CSlave *i2c, enum i2c_event event)
  static void pca955x_get_led(Object *obj, Visitor *v, const char *name,
                              void *opaque, Error **errp)
  {
 +    PCA955xClass *k = PCA955X_GET_CLASS(obj);
      PCA955xState *s = PCA955X(obj);
      int led, rc, reg;
      uint8_t state;
@@ -XXX,XX +XXX,XX @@ static void pca955x_get_led(Object *obj, Visitor *v, const char *name,
          error_setg(errp, "%s: error reading %s", __func__, name);
          return;
      }
 -    if (led < 0 || led > s->pin_count) {
 +    if (led < 0 || led > k->pin_count) {
          error_setg(errp, "%s invalid led %s", __func__, name);
          return;
      }
@@ -XXX,XX +XXX,XX @@ static inline uint8_t pca955x_ledsel(uint8_t oldval, int led_num, int state)
  static void pca955x_set_led(Object *obj, Visitor *v, const char *name,
                              void *opaque, Error **errp)
  {
 +    PCA955xClass *k = PCA955X_GET_CLASS(obj);
      PCA955xState *s = PCA955X(obj);
      Error *local_err = NULL;
      int led, rc, reg, val;
@@ -XXX,XX +XXX,XX @@ static void pca955x_set_led(Object *obj, Visitor *v, const char *name,
          error_setg(errp, "%s: error reading %s", __func__, name);
          return;
      }
 -    if (led < 0 || led > s->pin_count) {
 +    if (led < 0 || led > k->pin_count) {
          error_setg(errp, "%s invalid led %s", __func__, name);
          return;
      }
@@ -XXX,XX +XXX,XX @@ static void pca9552_reset(DeviceState *dev)
  static void pca955x_initfn(Object *obj)
  {
 -    PCA955xState *s = PCA955X(obj);
 +    PCA955xClass *k = PCA955X_GET_CLASS(obj);
      int led;
 -    /* If support for the other PCA955X devices are implemented, these
 -     * constant values might be part of class structure describing the
 -     * PCA955X device
 -     */
 -    s->max_reg = PCA9552_LS3;
 -    s->pin_count = 16;
 -
 -    for (led = 0; led < s->pin_count; led++) {
 +    assert(k->pin_count <= PCA955X_PIN_COUNT_MAX);
 +    for (led = 0; led < k->pin_count; led++) {
          char *name;
          name = g_strdup_printf("led%d", led);
@@ -XXX,XX +XXX,XX @@ static void pca955x_initfn(Object *obj)
      }
  }
 -static void pca9552_class_init(ObjectClass *klass, void *data)
 +static void pca955x_class_init(ObjectClass *klass, void *data)
  {
 -    DeviceClass *dc = DEVICE_CLASS(klass);
      I2CSlaveClass *k = I2C_SLAVE_CLASS(klass);
      k->event = pca955x_event;
      k->recv = pca955x_recv;
      k->send = pca955x_send;
 +}
 +
 +static const TypeInfo pca955x_info = {
 +    .name          = TYPE_PCA955X,
 +    .parent        = TYPE_I2C_SLAVE,
 +    .instance_init = pca955x_initfn,
 +    .instance_size = sizeof(PCA955xState),
 +    .class_init    = pca955x_class_init,
 +    .abstract      = true,
 +};
 +
 +static void pca9552_class_init(ObjectClass *oc, void *data)
 +{
 +    DeviceClass *dc = DEVICE_CLASS(oc);
 +    PCA955xClass *pc = PCA955X_CLASS(oc);
 +
      dc->reset = pca9552_reset;
      dc->vmsd = &pca9552_vmstate;
 +    pc->max_reg = PCA9552_LS3;
 +    pc->pin_count = 16;
  }
  static const TypeInfo pca9552_info = {
      .name          = TYPE_PCA9552,
 -    .parent        = TYPE_I2C_SLAVE,
 -    .instance_init = pca955x_initfn,
 -    .instance_size = sizeof(PCA955xState),
 +    .parent        = TYPE_PCA955X,
      .class_init    = pca9552_class_init,
  };
  static void pca955x_register_types(void)
  {
 +    type_register_static(&pca955x_info);
      type_register_static(&pca9552_info);
  }
 --
-.20.1
+.34.1

-[PULL 30/57] target/arm: Simplify DC_ZVA
+[PULL 58/72] target/riscv: Set default NaN pattern explicitly
-From: Richard Henderson <richard.henderson@linaro.org>
+Set the default NaN pattern explicitly for riscv.
-Now that we know that the operation is on a single page,
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-we need not loop over pages while probing.
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20241202131347.498124-53-peter.maydell@linaro.org
 ---
  target/riscv/cpu.c | 2 ++
 file changed, 2 insertions(+)
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+diff --git a/target/riscv/cpu.c b/target/riscv/cpu.c
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20200626033144.790098-19-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/helper-a64.c | 94 +++++++++++------------------------------
 file changed, 25 insertions(+), 69 deletions(-)
 diff --git a/target/arm/helper-a64.c b/target/arm/helper-a64.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-a64.c
+--- a/target/riscv/cpu.c
-+++ b/target/arm/helper-a64.c
++++ b/target/riscv/cpu.c
-@@ -XXX,XX +XXX,XX @@ void HELPER(dc_zva)(CPUARMState *env, uint64_t vaddr_in)
+@@ -XXX,XX +XXX,XX @@ static void riscv_cpu_reset_hold(Object *obj, ResetType type)
-      * (which matches the usual QEMU behaviour of not implementing either
+     cs->exception_index = RISCV_EXCP_NONE;
-      * alignment faults or any memory attribute handling).
+     env->load_res = -1;
-      */
+     set_default_nan_mode(1, &env->fp_status);
--
++    /* Default NaN value: sign bit clear, frac msb set */
--    ARMCPU *cpu = env_archcpu(env);
++    set_float_default_nan_pattern(0b01000000, &env->fp_status);
--    uint64_t blocklen = 4 << cpu->dcz_blocksize;
+     env->vill = true;
 +    int blocklen = 4 << env_archcpu(env)->dcz_blocksize;
      uint64_t vaddr = vaddr_in & ~(blocklen - 1);
 +    int mmu_idx = cpu_mmu_index(env, false);
 +    void *mem;
 +
 +    /*
 +     * Trapless lookup.  In addition to actual invalid page, may
 +     * return NULL for I/O, watchpoints, clean pages, etc.
 +     */
 +    mem = tlb_vaddr_to_host(env, vaddr, MMU_DATA_STORE, mmu_idx);
  #ifndef CONFIG_USER_ONLY
--    {
-+    if (unlikely(!mem)) {
-+        uintptr_t ra = GETPC();
-+
-         /*
--         * Slightly awkwardly, QEMU's TARGET_PAGE_SIZE may be less than
--         * the block size so we might have to do more than one TLB lookup.
--         * We know that in fact for any v8 CPU the page size is at least 4K
--         * and the block size must be 2K or less, but TARGET_PAGE_SIZE is only
--         * 1K as an artefact of legacy v5 subpage support being present in the
--         * same QEMU executable. So in practice the hostaddr[] array has
--         * two entries, given the current setting of TARGET_PAGE_BITS_MIN.
-+         * Trap if accessing an invalid page.  DC_ZVA requires that we supply
-+         * the original pointer for an invalid page.  But watchpoints require
-+         * that we probe the actual space.  So do both.
-          */
--        int maxidx = DIV_ROUND_UP(blocklen, TARGET_PAGE_SIZE);
--        void *hostaddr[DIV_ROUND_UP(2 * KiB, 1 << TARGET_PAGE_BITS_MIN)];
--        int try, i;
--        unsigned mmu_idx = cpu_mmu_index(env, false);
--        TCGMemOpIdx oi = make_memop_idx(MO_UB, mmu_idx);
-+        (void) probe_write(env, vaddr_in, 1, mmu_idx, ra);
-+        mem = probe_write(env, vaddr, blocklen, mmu_idx, ra);
--        assert(maxidx <= ARRAY_SIZE(hostaddr));
--
--        for (try = 0; try < 2; try++) {
--
--            for (i = 0; i < maxidx; i++) {
--                hostaddr[i] = tlb_vaddr_to_host(env,
--                                                vaddr + TARGET_PAGE_SIZE * i,
--                                                1, mmu_idx);
--                if (!hostaddr[i]) {
--                    break;
--                }
--            }
--            if (i == maxidx) {
--                /*
--                 * If it's all in the TLB it's fair game for just writing to;
--                 * we know we don't need to update dirty status, etc.
--                 */
--                for (i = 0; i < maxidx - 1; i++) {
--                    memset(hostaddr[i], 0, TARGET_PAGE_SIZE);
--                }
--                memset(hostaddr[i], 0, blocklen - (i * TARGET_PAGE_SIZE));
--                return;
--            }
-+        if (unlikely(!mem)) {
-             /*
--             * OK, try a store and see if we can populate the tlb. This
--             * might cause an exception if the memory isn't writable,
--             * in which case we will longjmp out of here. We must for
--             * this purpose use the actual register value passed to us
--             * so that we get the fault address right.
-+             * The only remaining reason for mem == NULL is I/O.
-+             * Just do a series of byte writes as the architecture demands.
-              */
--            helper_ret_stb_mmu(env, vaddr_in, 0, oi, GETPC());
--            /* Now we can populate the other TLB entries, if any */
--            for (i = 0; i < maxidx; i++) {
--                uint64_t va = vaddr + TARGET_PAGE_SIZE * i;
--                if (va != (vaddr_in & TARGET_PAGE_MASK)) {
--                    helper_ret_stb_mmu(env, va, 0, oi, GETPC());
--                }
-+            for (int i = 0; i < blocklen; i++) {
-+                cpu_stb_mmuidx_ra(env, vaddr + i, 0, mmu_idx, ra);
-             }
--        }
--
--        /*
--         * Slow path (probably attempt to do this to an I/O device or
--         * similar, or clearing of a block of code we have translations
--         * cached for). Just do a series of byte writes as the architecture
--         * demands. It's not worth trying to use a cpu_physical_memory_map(),
--         * memset(), unmap() sequence here because:
--         *  + we'd need to account for the blocksize being larger than a page
--         *  + the direct-RAM access case is almost always going to be dealt
--         *    with in the fastpath code above, so there's no speed benefit
--         *  + we would have to deal with the map returning NULL because the
--         *    bounce buffer was in use
--         */
--        for (i = 0; i < blocklen; i++) {
--            helper_ret_stb_mmu(env, vaddr + i, 0, oi, GETPC());
-+            return;
-         }
-     }
--#else
--    memset(g2h(vaddr), 0, blocklen);
- #endif
-+
-+    memset(mem, 0, blocklen);
- }
 --
-.20.1
+.34.1

-[PULL 02/57] hw/arm/aspeed: Rename AspeedBoardState as AspeedMachineState
+[PULL 59/72] target/tricore: Set default NaN pattern explicitly
-From: Philippe Mathieu-Daudé <f4bug@amsat.org>
+Set the default NaN pattern explicitly for tricore.
-To have a more consistent naming, rename AspeedBoardState
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-as AspeedMachineState.
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20241202131347.498124-54-peter.maydell@linaro.org
 ---
  target/tricore/helper.c | 2 ++
 file changed, 2 insertions(+)
-Suggested-by: Cédric Le Goater <clg@kaod.org>
+diff --git a/target/tricore/helper.c b/target/tricore/helper.c
 Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
 Reviewed-by: Cédric Le Goater <clg@kaod.org>
 Message-id: 20200623072132.2868-3-f4bug@amsat.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  include/hw/arm/aspeed.h |  4 ++--
  hw/arm/aspeed.c         | 20 ++++++++++----------
 files changed, 12 insertions(+), 12 deletions(-)
 diff --git a/include/hw/arm/aspeed.h b/include/hw/arm/aspeed.h
 index XXXXXXX..XXXXXXX 100644
---- a/include/hw/arm/aspeed.h
+--- a/target/tricore/helper.c
-+++ b/include/hw/arm/aspeed.h
++++ b/target/tricore/helper.c
-@@ -XXX,XX +XXX,XX @@
+@@ -XXX,XX +XXX,XX @@ void fpu_set_state(CPUTriCoreState *env)
+     set_flush_to_zero(1, &env->fp_status);
- #include "hw/boards.h"
+     set_float_detect_tininess(float_tininess_before_rounding, &env->fp_status);
+     set_default_nan_mode(1, &env->fp_status);
--typedef struct AspeedBoardState AspeedBoardState;
++    /* Default NaN pattern: sign bit clear, frac msb set */
-+typedef struct AspeedMachineState AspeedMachineState;
++    set_float_default_nan_pattern(0b01000000, &env->fp_status);
  #define TYPE_ASPEED_MACHINE       MACHINE_TYPE_NAME("aspeed")
  #define ASPEED_MACHINE(obj) \
@@ -XXX,XX +XXX,XX @@ typedef struct AspeedMachineClass {
      const char *spi_model;
      uint32_t num_cs;
      uint32_t macs_mask;
 -    void (*i2c_init)(AspeedBoardState *bmc);
 +    void (*i2c_init)(AspeedMachineState *bmc);
  } AspeedMachineClass;
 diff --git a/hw/arm/aspeed.c b/hw/arm/aspeed.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/arm/aspeed.c
 +++ b/hw/arm/aspeed.c
@@ -XXX,XX +XXX,XX @@ static struct arm_boot_info aspeed_board_binfo = {
      .board_id = -1, /* device-tree-only board */
  };
 -struct AspeedBoardState {
 +struct AspeedMachineState {
      AspeedSoCState soc;
      MemoryRegion ram_container;
      MemoryRegion max_ram;
@@ -XXX,XX +XXX,XX @@ static void sdhci_attach_drive(SDHCIState *sdhci, DriveInfo *dinfo)
  static void aspeed_machine_init(MachineState *machine)
  {
 -    AspeedBoardState *bmc;
 +    AspeedMachineState *bmc;
      AspeedMachineClass *amc = ASPEED_MACHINE_GET_CLASS(machine);
      AspeedSoCClass *sc;
      DriveInfo *drive0 = drive_get(IF_MTD, 0, 0);
@@ -XXX,XX +XXX,XX @@ static void aspeed_machine_init(MachineState *machine)
      int i;
      NICInfo *nd = &nd_table[0];
 -    bmc = g_new0(AspeedBoardState, 1);
 +    bmc = g_new0(AspeedMachineState, 1);
      memory_region_init(&bmc->ram_container, NULL, "aspeed-ram-container",
 * GiB);
@@ -XXX,XX +XXX,XX @@ static void aspeed_machine_init(MachineState *machine)
      arm_load_kernel(ARM_CPU(first_cpu), machine, &aspeed_board_binfo);
  }
--static void palmetto_bmc_i2c_init(AspeedBoardState *bmc)
+ uint32_t psw_read(CPUTriCoreState *env)
 +static void palmetto_bmc_i2c_init(AspeedMachineState *bmc)
  {
      AspeedSoCState *soc = &bmc->soc;
      DeviceState *dev;
@@ -XXX,XX +XXX,XX @@ static void palmetto_bmc_i2c_init(AspeedBoardState *bmc)
      object_property_set_int(OBJECT(dev), 110000, "temperature3", &error_abort);
  }
 -static void ast2500_evb_i2c_init(AspeedBoardState *bmc)
 +static void ast2500_evb_i2c_init(AspeedMachineState *bmc)
  {
      AspeedSoCState *soc = &bmc->soc;
      uint8_t *eeprom_buf = g_malloc0(8 * 1024);
@@ -XXX,XX +XXX,XX @@ static void ast2500_evb_i2c_init(AspeedBoardState *bmc)
      i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 11), "ds1338", 0x32);
  }
 -static void ast2600_evb_i2c_init(AspeedBoardState *bmc)
 +static void ast2600_evb_i2c_init(AspeedMachineState *bmc)
  {
      /* Start with some devices on our I2C busses */
      ast2500_evb_i2c_init(bmc);
  }
 -static void romulus_bmc_i2c_init(AspeedBoardState *bmc)
 +static void romulus_bmc_i2c_init(AspeedMachineState *bmc)
  {
      AspeedSoCState *soc = &bmc->soc;
@@ -XXX,XX +XXX,XX @@ static void romulus_bmc_i2c_init(AspeedBoardState *bmc)
      i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 11), "ds1338", 0x32);
  }
 -static void swift_bmc_i2c_init(AspeedBoardState *bmc)
 +static void swift_bmc_i2c_init(AspeedMachineState *bmc)
  {
      AspeedSoCState *soc = &bmc->soc;
@@ -XXX,XX +XXX,XX @@ static void swift_bmc_i2c_init(AspeedBoardState *bmc)
      i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 12), "tmp105", 0x4a);
  }
 -static void sonorapass_bmc_i2c_init(AspeedBoardState *bmc)
 +static void sonorapass_bmc_i2c_init(AspeedMachineState *bmc)
  {
      AspeedSoCState *soc = &bmc->soc;
@@ -XXX,XX +XXX,XX @@ static void sonorapass_bmc_i2c_init(AspeedBoardState *bmc)
  }
 -static void witherspoon_bmc_i2c_init(AspeedBoardState *bmc)
 +static void witherspoon_bmc_i2c_init(AspeedMachineState *bmc)
  {
      AspeedSoCState *soc = &bmc->soc;
      uint8_t *eeprom_buf = g_malloc0(8 * 1024);
 --
-.20.1
+.34.1

-New patch
+[PULL 60/72] fpu: Remove default handling for dnan_pattern
+Now that all our targets have bene converted to explicitly specify
+their pattern for the default NaN value we can remove the remaining
+fallback code in parts64_default_nan().
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241202131347.498124-55-peter.maydell@linaro.org
+---
+ fpu/softfloat-specialize.c.inc | 14 --------------
+file changed, 14 deletions(-)
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
+index XXXXXXX..XXXXXXX 100644
+--- a/fpu/softfloat-specialize.c.inc
++++ b/fpu/softfloat-specialize.c.inc
+@@ -XXX,XX +XXX,XX @@ static void parts64_default_nan(FloatParts64 *p, float_status *status)
+     uint64_t frac;
+     uint8_t dnan_pattern = status->default_nan_pattern;
+-    if (dnan_pattern == 0) {
+-        /*
+-         * This case is true for Alpha, ARM, MIPS, OpenRISC, PPC, RISC-V,
+-         * S390, SH4, TriCore, and Xtensa.  Our other supported targets
+-         * do not have floating-point.
+-         */
+-        if (snan_bit_is_one(status)) {
+-            /* sign bit clear, set all frac bits other than msb */
+-            dnan_pattern = 0b00111111;
+-        } else {
+-            /* sign bit clear, set frac msb */
+-            dnan_pattern = 0b01000000;
+-        }
+-    }
+     assert(dnan_pattern != 0);
+     sign = dnan_pattern >> 7;
+--
+.34.1

-[PULL 16/57] target/arm: Add support for MTE to HCR_EL2 and SCR_EL3
+[PULL 61/72] softfloat: Inline pickNaNMulAdd
 From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Inline pickNaNMulAdd into its only caller.  This makes
 one assert redundant with the immediately preceding IF.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20200626033144.790098-5-richard.henderson@linaro.org
+Reviewed-by: Philippe Mathieu-Daudé <philmd@linaro.org>
 Message-id: 20241203203949.483774-3-richard.henderson@linaro.org
 [PMM: keep comment from old code in new location]
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper.c | 14 +++++++++++---
+ fpu/softfloat-parts.c.inc      | 41 +++++++++++++++++++++++++-
-file changed, 11 insertions(+), 3 deletions(-)
+ fpu/softfloat-specialize.c.inc | 54 ----------------------------------
 files changed, 40 insertions(+), 55 deletions(-)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/fpu/softfloat-parts.c.inc
-+++ b/target/arm/helper.c
++++ b/fpu/softfloat-parts.c.inc
-@@ -XXX,XX +XXX,XX @@ static void scr_write(CPUARMState *env, const ARMCPRegInfo *ri, uint64_t value)
+@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
-         if (cpu_isar_feature(aa64_pauth, cpu)) {
+     }
-             valid_mask |= SCR_API | SCR_APK;
-         }
+     if (s->default_nan_mode) {
-+        if (cpu_isar_feature(aa64_mte, cpu)) {
++        /*
-+            valid_mask |= SCR_ATA;
++         * We guarantee not to require the target to tell us how to
 +         * pick a NaN if we're always returning the default NaN.
 +         * But if we're not in default-NaN mode then the target must
 +         * specify.
 +         */
          which = 3;
 +    } else if (infzero) {
 +        /*
 +         * Inf * 0 + NaN -- some implementations return the
 +         * default NaN here, and some return the input NaN.
 +         */
 +        switch (s->float_infzeronan_rule) {
 +        case float_infzeronan_dnan_never:
 +            which = 2;
 +            break;
 +        case float_infzeronan_dnan_always:
 +            which = 3;
 +            break;
 +        case float_infzeronan_dnan_if_qnan:
 +            which = is_qnan(c->cls) ? 3 : 2;
 +            break;
 +        default:
 +            g_assert_not_reached();
 +        }
      } else {
-         valid_mask &= ~(SCR_RW | SCR_ST);
+-        which = pickNaNMulAdd(a->cls, b->cls, c->cls, infzero, have_snan, s);
-     }
++        FloatClass cls[3] = { a->cls, b->cls, c->cls };
-@@ -XXX,XX +XXX,XX @@ static void do_hcr_write(CPUARMState *env, uint64_t value, uint64_t valid_mask)
++        Float3NaNPropRule rule = s->float_3nan_prop_rule;
-         if (cpu_isar_feature(aa64_pauth, cpu)) {
++
-             valid_mask |= HCR_API | HCR_APK;
++        assert(rule != float_3nan_prop_none);
-         }
++        if (have_snan && (rule & R_3NAN_SNAN_MASK)) {
-+        if (cpu_isar_feature(aa64_mte, cpu)) {
++            /* We have at least one SNaN input and should prefer it */
-+            valid_mask |= HCR_ATA | HCR_DCT | HCR_TID5;
++            do {
 +                which = rule & R_3NAN_1ST_MASK;
 +                rule >>= R_3NAN_1ST_LENGTH;
 +            } while (!is_snan(cls[which]));
 +        } else {
 +            do {
 +                which = rule & R_3NAN_1ST_MASK;
 +                rule >>= R_3NAN_1ST_LENGTH;
 +            } while (!is_nan(cls[which]));
 +        }
      }
-     /* Clear RES0 bits.  */
+     if (which == 3) {
-     value &= valid_mask;
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
+index XXXXXXX..XXXXXXX 100644
--    /* These bits change the MMU setup:
+--- a/fpu/softfloat-specialize.c.inc
-+    /*
++++ b/fpu/softfloat-specialize.c.inc
-+     * These bits change the MMU setup:
+@@ -XXX,XX +XXX,XX @@ static int pickNaN(FloatClass a_cls, FloatClass b_cls,
       * HCR_VM enables stage 2 translation
       * HCR_PTW forbids certain page-table setups
 -     * HCR_DC Disables stage1 and enables stage2 translation
 +     * HCR_DC disables stage1 and enables stage2 translation
 +     * HCR_DCT enables tagging on (disabled) stage1 translation
       */
 -    if ((env->cp15.hcr_el2 ^ value) & (HCR_VM | HCR_PTW | HCR_DC)) {
 +    if ((env->cp15.hcr_el2 ^ value) & (HCR_VM | HCR_PTW | HCR_DC | HCR_DCT)) {
          tlb_flush(CPU(cpu));
      }
-     env->cp15.hcr_el2 = value;
+ }
 -/*----------------------------------------------------------------------------
 -| Select which NaN to propagate for a three-input operation.
 -| For the moment we assume that no CPU needs the 'larger significand'
 -| information.
 -| Return values : 0 : a; 1 : b; 2 : c; 3 : default-NaN
 -*----------------------------------------------------------------------------*/
 -static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
 -                         bool infzero, bool have_snan, float_status *status)
 -{
 -    FloatClass cls[3] = { a_cls, b_cls, c_cls };
 -    Float3NaNPropRule rule = status->float_3nan_prop_rule;
 -    int which;
 -
 -    /*
 -     * We guarantee not to require the target to tell us how to
 -     * pick a NaN if we're always returning the default NaN.
 -     * But if we're not in default-NaN mode then the target must
 -     * specify.
 -     */
 -    assert(!status->default_nan_mode);
 -
 -    if (infzero) {
 -        /*
 -         * Inf * 0 + NaN -- some implementations return the default NaN here,
 -         * and some return the input NaN.
 -         */
 -        switch (status->float_infzeronan_rule) {
 -        case float_infzeronan_dnan_never:
 -            return 2;
 -        case float_infzeronan_dnan_always:
 -            return 3;
 -        case float_infzeronan_dnan_if_qnan:
 -            return is_qnan(c_cls) ? 3 : 2;
 -        default:
 -            g_assert_not_reached();
 -        }
 -    }
 -
 -    assert(rule != float_3nan_prop_none);
 -    if (have_snan && (rule & R_3NAN_SNAN_MASK)) {
 -        /* We have at least one SNaN input and should prefer it */
 -        do {
 -            which = rule & R_3NAN_1ST_MASK;
 -            rule >>= R_3NAN_1ST_LENGTH;
 -        } while (!is_snan(cls[which]));
 -    } else {
 -        do {
 -            which = rule & R_3NAN_1ST_MASK;
 -            rule >>= R_3NAN_1ST_LENGTH;
 -        } while (!is_nan(cls[which]));
 -    }
 -    return which;
 -}
 -
  /*----------------------------------------------------------------------------
  | Returns 1 if the double-precision floating-point value `a' is a quiet
  | NaN; otherwise returns 0.
 --
-.20.1
+.34.1

-[PULL 41/57] target/arm: Use mte_checkN for sve unpredicated stores
+[PULL 62/72] softfloat: Use goto for default nan case in pick_nan_muladd
 From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Remove "3" as a special case for which and simply
 branch to return the desired value.
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20200626033144.790098-30-richard.henderson@linaro.org
+Reviewed-by: Philippe Mathieu-Daudé <philmd@linaro.org>
 Message-id: 20241203203949.483774-4-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate-sve.c | 61 +++++++++++++++++++++-----------------
+ fpu/softfloat-parts.c.inc | 20 ++++++++++----------
-file changed, 33 insertions(+), 28 deletions(-)
+file changed, 10 insertions(+), 10 deletions(-)
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
+--- a/fpu/softfloat-parts.c.inc
-+++ b/target/arm/translate-sve.c
++++ b/fpu/softfloat-parts.c.inc
-@@ -XXX,XX +XXX,XX @@ static void do_str(DisasContext *s, uint32_t vofs, int len, int rn, int imm)
+@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
-     int len_remain = len % 8;
+          * But if we're not in default-NaN mode then the target must
-     int nparts = len / 8 + ctpop8(len_remain);
+          * specify.
-     int midx = get_mem_index(s);
+          */
--    TCGv_i64 addr, t0;
+-        which = 3;
-+    TCGv_i64 dirty_addr, clean_addr, t0;
++        goto default_nan;
+     } else if (infzero) {
--    addr = tcg_temp_new_i64();
+         /*
--    t0 = tcg_temp_new_i64();
+          * Inf * 0 + NaN -- some implementations return the
-+    dirty_addr = tcg_temp_new_i64();
+@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
-+    tcg_gen_addi_i64(dirty_addr, cpu_reg_sp(s, rn), imm);
+          */
-+    clean_addr = gen_mte_checkN(s, dirty_addr, false, rn != 31, len, MO_8);
+         switch (s->float_infzeronan_rule) {
-+    tcg_temp_free_i64(dirty_addr);
+         case float_infzeronan_dnan_never:
+-            which = 2;
      /* Note that unpredicated load/store of vector/predicate registers
       * are defined as a stream of bytes, which equates to little-endian
@@ -XXX,XX +XXX,XX @@ static void do_str(DisasContext *s, uint32_t vofs, int len, int rn, int imm)
      if (nparts <= 4) {
          int i;
 +        t0 = tcg_temp_new_i64();
          for (i = 0; i < len_align; i += 8) {
              tcg_gen_ld_i64(t0, cpu_env, vofs + i);
 -            tcg_gen_addi_i64(addr, cpu_reg_sp(s, rn), imm + i);
 -            tcg_gen_qemu_st_i64(t0, addr, midx, MO_LEQ);
 +            tcg_gen_qemu_st_i64(t0, clean_addr, midx, MO_LEQ);
 +            tcg_gen_addi_i64(clean_addr, cpu_reg_sp(s, rn), 8);
          }
 +        tcg_temp_free_i64(t0);
      } else {
          TCGLabel *loop = gen_new_label();
 -        TCGv_ptr t2, i = tcg_const_local_ptr(0);
 +        TCGv_ptr tp, i = tcg_const_local_ptr(0);
 +
 +        /* Copy the clean address into a local temp, live across the loop. */
 +        t0 = clean_addr;
 +        clean_addr = tcg_temp_local_new_i64();
 +        tcg_gen_mov_i64(clean_addr, t0);
 +        tcg_temp_free_i64(t0);
          gen_set_label(loop);
 -        t2 = tcg_temp_new_ptr();
 -        tcg_gen_add_ptr(t2, cpu_env, i);
 -        tcg_gen_ld_i64(t0, t2, vofs);
 -
 -        /* Minimize the number of local temps that must be re-read from
 -         * the stack each iteration.  Instead, re-compute values other
 -         * than the loop counter.
 -         */
 -        tcg_gen_addi_ptr(t2, i, imm);
 -        tcg_gen_extu_ptr_i64(addr, t2);
 -        tcg_gen_add_i64(addr, addr, cpu_reg_sp(s, rn));
 -        tcg_temp_free_ptr(t2);
 -
 -        tcg_gen_qemu_st_i64(t0, addr, midx, MO_LEQ);
 -
 +        t0 = tcg_temp_new_i64();
 +        tp = tcg_temp_new_ptr();
 +        tcg_gen_add_ptr(tp, cpu_env, i);
 +        tcg_gen_ld_i64(t0, tp, vofs);
          tcg_gen_addi_ptr(i, i, 8);
 +        tcg_temp_free_ptr(tp);
 +
 +        tcg_gen_qemu_st_i64(t0, clean_addr, midx, MO_LEQ);
 +        tcg_gen_addi_i64(clean_addr, clean_addr, 8);
 +        tcg_temp_free_i64(t0);
          tcg_gen_brcondi_ptr(TCG_COND_LTU, i, len_align, loop);
          tcg_temp_free_ptr(i);
@@ -XXX,XX +XXX,XX @@ static void do_str(DisasContext *s, uint32_t vofs, int len, int rn, int imm)
      /* Predicate register stores can be any multiple of 2.  */
      if (len_remain) {
 +        t0 = tcg_temp_new_i64();
          tcg_gen_ld_i64(t0, cpu_env, vofs + len_align);
 -        tcg_gen_addi_i64(addr, cpu_reg_sp(s, rn), imm + len_align);
          switch (len_remain) {
          case 2:
          case 4:
          case 8:
 -            tcg_gen_qemu_st_i64(t0, addr, midx, MO_LE | ctz32(len_remain));
 +            tcg_gen_qemu_st_i64(t0, clean_addr, midx,
 +                                MO_LE | ctz32(len_remain));
              break;
+         case float_infzeronan_dnan_always:
-         case 6:
+-            which = 3;
--            tcg_gen_qemu_st_i64(t0, addr, midx, MO_LEUL);
+-            break;
--            tcg_gen_addi_i64(addr, addr, 4);
++            goto default_nan;
-+            tcg_gen_qemu_st_i64(t0, clean_addr, midx, MO_LEUL);
+         case float_infzeronan_dnan_if_qnan:
-+            tcg_gen_addi_i64(clean_addr, clean_addr, 4);
+-            which = is_qnan(c->cls) ? 3 : 2;
-             tcg_gen_shri_i64(t0, t0, 32);
++            if (is_qnan(c->cls)) {
--            tcg_gen_qemu_st_i64(t0, addr, midx, MO_LEUW);
++                goto default_nan;
-+            tcg_gen_qemu_st_i64(t0, clean_addr, midx, MO_LEUW);
++            }
              break;
          default:
              g_assert_not_reached();
          }
-+        tcg_temp_free_i64(t0);
++        which = 2;
      } else {
          FloatClass cls[3] = { a->cls, b->cls, c->cls };
          Float3NaNPropRule rule = s->float_3nan_prop_rule;
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
          }
      }
--    tcg_temp_free_i64(addr);
--    tcg_temp_free_i64(t0);
+-    if (which == 3) {
-+    tcg_temp_free_i64(clean_addr);
+-        parts_default_nan(a, s);
 -        return a;
 -    }
 -
      switch (which) {
      case 0:
          break;
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
          parts_silence_nan(a, s);
      }
      return a;
 +
 + default_nan:
 +    parts_default_nan(a, s);
 +    return a;
  }
- static bool trans_LDR_zri(DisasContext *s, arg_rri *a)
+ /*
 --
-.20.1
+.34.1

-[PULL 14/57] target/arm: Improve masking of SCR RES0 bits
+[PULL 63/72] softfloat: Remove which from parts_pick_nan_muladd
 From: Richard Henderson <richard.henderson@linaro.org>
-Protect reads of aa64 id registers with ARM_CP_STATE_AA64.
+Assign the pointer return value to 'a' directly,
-Use this as a simpler test than arm_el_is_aa64, since EL3
+rather than going through an intermediary index.
 cannot change mode.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20200626033144.790098-3-richard.henderson@linaro.org
+Reviewed-by: Philippe Mathieu-Daudé <philmd@linaro.org>
 Message-id: 20241203203949.483774-5-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper.c | 15 ++++++++-------
+ fpu/softfloat-parts.c.inc | 32 ++++++++++----------------------
-file changed, 8 insertions(+), 7 deletions(-)
+file changed, 10 insertions(+), 22 deletions(-)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/fpu/softfloat-parts.c.inc
-+++ b/target/arm/helper.c
++++ b/fpu/softfloat-parts.c.inc
-@@ -XXX,XX +XXX,XX @@ static void scr_write(CPUARMState *env, const ARMCPRegInfo *ri, uint64_t value)
+@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
-     uint32_t valid_mask = 0x3fff;
+                                             FloatPartsN *c, float_status *s,
-     ARMCPU *cpu = env_archcpu(env);
+                                             int ab_mask, int abc_mask)
+ {
--    if (arm_el_is_aa64(env, 3)) {
+-    int which;
-+    if (ri->state == ARM_CP_STATE_AA64) {
+     bool infzero = (ab_mask == float_cmask_infzero);
-         value |= SCR_FW | SCR_AW;   /* these two bits are RES1.  */
+     bool have_snan = (abc_mask & float_cmask_snan);
-         valid_mask &= ~SCR_NET;
++    FloatPartsN *ret;
-+
-+        if (cpu_isar_feature(aa64_lor, cpu)) {
+     if (unlikely(have_snan)) {
-+            valid_mask |= SCR_TLOR;
+         float_raise(float_flag_invalid | float_flag_invalid_snan, s);
-+        }
+@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
-+        if (cpu_isar_feature(aa64_pauth, cpu)) {
+         default:
-+            valid_mask |= SCR_API | SCR_APK;
+             g_assert_not_reached();
-+        }
+         }
 -        which = 2;
 +        ret = c;
      } else {
-         valid_mask &= ~(SCR_RW | SCR_ST);
+-        FloatClass cls[3] = { a->cls, b->cls, c->cls };
-     }
++        FloatPartsN *val[3] = { a, b, c };
-@@ -XXX,XX +XXX,XX @@ static void scr_write(CPUARMState *env, const ARMCPRegInfo *ri, uint64_t value)
+         Float3NaNPropRule rule = s->float_3nan_prop_rule;
-             valid_mask &= ~SCR_SMD;
          assert(rule != float_3nan_prop_none);
          if (have_snan && (rule & R_3NAN_SNAN_MASK)) {
              /* We have at least one SNaN input and should prefer it */
              do {
 -                which = rule & R_3NAN_1ST_MASK;
 +                ret = val[rule & R_3NAN_1ST_MASK];
                  rule >>= R_3NAN_1ST_LENGTH;
 -            } while (!is_snan(cls[which]));
 +            } while (!is_snan(ret->cls));
          } else {
              do {
 -                which = rule & R_3NAN_1ST_MASK;
 +                ret = val[rule & R_3NAN_1ST_MASK];
                  rule >>= R_3NAN_1ST_LENGTH;
 -            } while (!is_nan(cls[which]));
 +            } while (!is_nan(ret->cls));
          }
      }
--    if (cpu_isar_feature(aa64_lor, cpu)) {
--        valid_mask |= SCR_TLOR;
+-    switch (which) {
 -    case 0:
 -        break;
 -    case 1:
 -        a = b;
 -        break;
 -    case 2:
 -        a = c;
 -        break;
 -    default:
 -        g_assert_not_reached();
 +    if (is_snan(ret->cls)) {
 +        parts_silence_nan(ret, s);
      }
 -    if (is_snan(a->cls)) {
 -        parts_silence_nan(a, s);
 -    }
--    if (cpu_isar_feature(aa64_pauth, cpu)) {
+-    return a;
--        valid_mask |= SCR_API | SCR_APK;
++    return ret;
--    }
+  default_nan:
-     /* Clear all-context RES0 bits.  */
+     parts_default_nan(a, s);
      value &= valid_mask;
 --
-.20.1
+.34.1

-[PULL 35/57] target/arm: Add gen_mte_check1
+[PULL 64/72] softfloat: Pad array size in pick_nan_muladd
 From: Richard Henderson <richard.henderson@linaro.org>
-Replace existing uses of check_data_tbi in translate-a64.c that
+While all indices into val[] should be in [0-2], the mask
-perform a single logical memory access.  Leave the helper blank
+applied is two bits.  To help static analysis see there is
-for now to reduce the patch size.
+no possibility of read beyond the end of the array, pad the
 array to 4 entries, with the final being (implicitly) NULL.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20200626033144.790098-24-richard.henderson@linaro.org
+Reviewed-by: Philippe Mathieu-Daudé <philmd@linaro.org>
 Message-id: 20241203203949.483774-6-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper-a64.h    |   1 +
+ fpu/softfloat-parts.c.inc | 2 +-
- target/arm/internals.h     |   8 +++
+file changed, 1 insertion(+), 1 deletion(-)
  target/arm/translate-a64.h |   2 +
  target/arm/mte_helper.c    |   8 +++
  target/arm/translate-a64.c | 100 ++++++++++++++++++++++++++++---------
 files changed, 95 insertions(+), 24 deletions(-)
-diff --git a/target/arm/helper-a64.h b/target/arm/helper-a64.h
+diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-a64.h
+--- a/fpu/softfloat-parts.c.inc
-+++ b/target/arm/helper-a64.h
++++ b/fpu/softfloat-parts.c.inc
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_3(autdb, TCG_CALL_NO_WG, i64, env, i64, i64)
+@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
  DEF_HELPER_FLAGS_2(xpaci, TCG_CALL_NO_RWG_SE, i64, env, i64)
  DEF_HELPER_FLAGS_2(xpacd, TCG_CALL_NO_RWG_SE, i64, env, i64)
 +DEF_HELPER_FLAGS_3(mte_check1, TCG_CALL_NO_WG, i64, env, i32, i64)
  DEF_HELPER_FLAGS_3(irg, TCG_CALL_NO_RWG, i64, env, i64, i64)
  DEF_HELPER_FLAGS_4(addsubg, TCG_CALL_NO_RWG_SE, i64, env, i64, s32, i32)
  DEF_HELPER_FLAGS_3(ldg, TCG_CALL_NO_WG, i64, env, i64, i64)
 diff --git a/target/arm/internals.h b/target/arm/internals.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/internals.h
 +++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ void arm_log_exception(int idx);
  #define LOG2_TAG_GRANULE 4
  #define TAG_GRANULE      (1 << LOG2_TAG_GRANULE)
 +/* Bits within a descriptor passed to the helper_mte_check* functions. */
 +FIELD(MTEDESC, MIDX,  0, 4)
 +FIELD(MTEDESC, TBI,   4, 2)
 +FIELD(MTEDESC, TCMA,  6, 2)
 +FIELD(MTEDESC, WRITE, 8, 1)
 +FIELD(MTEDESC, ESIZE, 9, 5)
 +FIELD(MTEDESC, TSIZE, 14, 10)  /* mte_checkN only */
 +
  static inline int allocation_tag_from_addr(uint64_t ptr)
  {
      return extract64(ptr, 56, 4);
 diff --git a/target/arm/translate-a64.h b/target/arm/translate-a64.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.h
 +++ b/target/arm/translate-a64.h
@@ -XXX,XX +XXX,XX @@ TCGv_ptr get_fpstatus_ptr(bool);
  bool logic_imm_decode_wmask(uint64_t *result, unsigned int immn,
                              unsigned int imms, unsigned int immr);
  bool sve_access_check(DisasContext *s);
 +TCGv_i64 gen_mte_check1(DisasContext *s, TCGv_i64 addr, bool is_write,
 +                        bool tag_checked, int log2_size);
  /* We should have at some point before trying to access an FP register
   * done the necessary access check, so assert that
 diff --git a/target/arm/mte_helper.c b/target/arm/mte_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/mte_helper.c
 +++ b/target/arm/mte_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(stzgm_tags)(CPUARMState *env, uint64_t ptr, uint64_t val)
          memset(mem, tag_pair, tag_bytes);
      }
  }
 +
 +/*
 + * Perform an MTE checked access for a single logical or atomic access.
 + */
 +uint64_t HELPER(mte_check1)(CPUARMState *env, uint32_t desc, uint64_t ptr)
 +{
 +    return ptr;
 +}
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void gen_a64_set_pc(DisasContext *s, TCGv_i64 src)
  }
  /*
 - * Return a "clean" address for ADDR according to TBID.
 - * This is always a fresh temporary, as we need to be able to
 - * increment this independently of a dirty write-back address.
 + * Handle MTE and/or TBI.
 + *
 + * For TBI, ideally, we would do nothing.  Proper behaviour on fault is
 + * for the tag to be present in the FAR_ELx register.  But for user-only
 + * mode we do not have a TLB with which to implement this, so we must
 + * remove the top byte now.
 + *
 + * Always return a fresh temporary that we can increment independently
 + * of the write-back address.
   */
 +
  static TCGv_i64 clean_data_tbi(DisasContext *s, TCGv_i64 addr)
  {
      TCGv_i64 clean = new_tmp_a64(s);
 -    /*
 -     * In order to get the correct value in the FAR_ELx register,
 -     * we must present the memory subsystem with the "dirty" address
 -     * including the TBI.  In system mode we can make this work via
 -     * the TLB, dropping the TBI during translation.  But for user-only
 -     * mode we don't have that option, and must remove the top byte now.
 -     */
  #ifdef CONFIG_USER_ONLY
      gen_top_byte_ignore(s, clean, addr, s->tbid);
  #else
@@ -XXX,XX +XXX,XX @@ static void gen_probe_access(DisasContext *s, TCGv_i64 ptr,
      tcg_temp_free_i32(t_size);
  }
 +/*
 + * For MTE, check a single logical or atomic access.  This probes a single
 + * address, the exact one specified.  The size and alignment of the access
 + * is not relevant to MTE, per se, but watchpoints do require the size,
 + * and we want to recognize those before making any other changes to state.
 + */
 +static TCGv_i64 gen_mte_check1_mmuidx(DisasContext *s, TCGv_i64 addr,
 +                                      bool is_write, bool tag_checked,
 +                                      int log2_size, bool is_unpriv,
 +                                      int core_idx)
 +{
 +    if (tag_checked && s->mte_active[is_unpriv]) {
 +        TCGv_i32 tcg_desc;
 +        TCGv_i64 ret;
 +        int desc = 0;
 +
 +        desc = FIELD_DP32(desc, MTEDESC, MIDX, core_idx);
 +        desc = FIELD_DP32(desc, MTEDESC, TBI, s->tbid);
 +        desc = FIELD_DP32(desc, MTEDESC, TCMA, s->tcma);
 +        desc = FIELD_DP32(desc, MTEDESC, WRITE, is_write);
 +        desc = FIELD_DP32(desc, MTEDESC, ESIZE, 1 << log2_size);
 +        tcg_desc = tcg_const_i32(desc);
 +
 +        ret = new_tmp_a64(s);
 +        gen_helper_mte_check1(ret, cpu_env, tcg_desc, addr);
 +        tcg_temp_free_i32(tcg_desc);
 +
 +        return ret;
 +    }
 +    return clean_data_tbi(s, addr);
 +}
 +
 +TCGv_i64 gen_mte_check1(DisasContext *s, TCGv_i64 addr, bool is_write,
 +                        bool tag_checked, int log2_size)
 +{
 +    return gen_mte_check1_mmuidx(s, addr, is_write, tag_checked, log2_size,
 +                                 false, get_mem_index(s));
 +}
 +
  typedef struct DisasCompare64 {
      TCGCond cond;
      TCGv_i64 value;
@@ -XXX,XX +XXX,XX @@ static void gen_compare_and_swap(DisasContext *s, int rs, int rt,
      if (rn == 31) {
          gen_check_sp_alignment(s);
      }
 -    clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
 +    clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn), true, rn != 31, size);
      tcg_gen_atomic_cmpxchg_i64(tcg_rs, clean_addr, tcg_rs, tcg_rt, memidx,
                                 size | MO_ALIGN | s->be_data);
  }
@@ -XXX,XX +XXX,XX @@ static void gen_compare_and_swap_pair(DisasContext *s, int rs, int rt,
      if (rn == 31) {
          gen_check_sp_alignment(s);
      }
 -    clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
 +
 +    /* This is a single atomic access, despite the "pair". */
 +    clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn), true, rn != 31, size + 1);
      if (size == 2) {
          TCGv_i64 cmp = tcg_temp_new_i64();
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
          if (is_lasr) {
              tcg_gen_mb(TCG_MO_ALL | TCG_BAR_STRL);
          }
--        clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
+         ret = c;
 +        clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn),
 +                                    true, rn != 31, size);
          gen_store_exclusive(s, rs, rt, rt2, clean_addr, size, false);
          return;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
          if (rn == 31) {
              gen_check_sp_alignment(s);
          }
 -        clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
 +        clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn),
 +                                    false, rn != 31, size);
          s->is_ldex = true;
          gen_load_exclusive(s, rt, rt2, clean_addr, size, false);
          if (is_lasr) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
              gen_check_sp_alignment(s);
          }
          tcg_gen_mb(TCG_MO_ALL | TCG_BAR_STRL);
 -        clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
 +        clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn),
 +                                    true, rn != 31, size);
          do_gpr_st(s, cpu_reg(s, rt), clean_addr, size, true, rt,
                    disas_ldst_compute_iss_sf(size, false, 0), is_lasr);
          return;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
          if (rn == 31) {
              gen_check_sp_alignment(s);
          }
 -        clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
 +        clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn),
 +                                    false, rn != 31, size);
          do_gpr_ld(s, cpu_reg(s, rt), clean_addr, size, false, false, true, rt,
                    disas_ldst_compute_iss_sf(size, false, 0), is_lasr);
          tcg_gen_mb(TCG_MO_ALL | TCG_BAR_LDAQ);
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
              if (is_lasr) {
                  tcg_gen_mb(TCG_MO_ALL | TCG_BAR_STRL);
              }
 -            clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
 +            clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn),
 +                                        true, rn != 31, size);
              gen_store_exclusive(s, rs, rt, rt2, clean_addr, size, true);
              return;
          }
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
              if (rn == 31) {
                  gen_check_sp_alignment(s);
              }
 -            clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
 +            clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn),
 +                                        false, rn != 31, size);
              s->is_ldex = true;
              gen_load_exclusive(s, rt, rt2, clean_addr, size, true);
              if (is_lasr) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_reg_imm9(DisasContext *s, uint32_t insn,
      bool iss_valid = !is_vector;
      bool post_index;
      bool writeback;
 +    int memidx;
      TCGv_i64 clean_addr, dirty_addr;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_reg_imm9(DisasContext *s, uint32_t insn,
      if (!post_index) {
          tcg_gen_addi_i64(dirty_addr, dirty_addr, imm9);
      }
 -    clean_addr = clean_data_tbi(s, dirty_addr);
 +
 +    memidx = is_unpriv ? get_a64_user_mem_index(s) : get_mem_index(s);
 +    clean_addr = gen_mte_check1_mmuidx(s, dirty_addr, is_store,
 +                                       writeback || rn != 31,
 +                                       size, is_unpriv, memidx);
      if (is_vector) {
          if (is_store) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_reg_imm9(DisasContext *s, uint32_t insn,
          }
      } else {
-         TCGv_i64 tcg_rt = cpu_reg(s, rt);
+-        FloatPartsN *val[3] = { a, b, c };
--        int memidx = is_unpriv ? get_a64_user_mem_index(s) : get_mem_index(s);
++        FloatPartsN *val[R_3NAN_1ST_MASK + 1] = { a, b, c };
-         bool iss_sf = disas_ldst_compute_iss_sf(size, is_signed, opc);
+         Float3NaNPropRule rule = s->float_3nan_prop_rule;
-         if (is_store) {
+         assert(rule != float_3nan_prop_none);
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_reg_roffset(DisasContext *s, uint32_t insn,
      ext_and_shift_reg(tcg_rm, tcg_rm, opt, shift ? size : 0);
      tcg_gen_add_i64(dirty_addr, dirty_addr, tcg_rm);
 -    clean_addr = clean_data_tbi(s, dirty_addr);
 +    clean_addr = gen_mte_check1(s, dirty_addr, is_store, true, size);
      if (is_vector) {
          if (is_store) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_reg_unsigned_imm(DisasContext *s, uint32_t insn,
      dirty_addr = read_cpu_reg_sp(s, rn, 1);
      offset = imm12 << size;
      tcg_gen_addi_i64(dirty_addr, dirty_addr, offset);
 -    clean_addr = clean_data_tbi(s, dirty_addr);
 +    clean_addr = gen_mte_check1(s, dirty_addr, is_store, rn != 31, size);
      if (is_vector) {
          if (is_store) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_atomic(DisasContext *s, uint32_t insn,
      if (rn == 31) {
          gen_check_sp_alignment(s);
      }
 -    clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
 +    clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn), false, rn != 31, size);
      if (o3_opc == 014) {
          /*
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_pac(DisasContext *s, uint32_t insn,
      tcg_gen_addi_i64(dirty_addr, dirty_addr, offset);
      /* Note that "clean" and "dirty" here refer to TBI not PAC.  */
 -    clean_addr = clean_data_tbi(s, dirty_addr);
 +    clean_addr = gen_mte_check1(s, dirty_addr, false,
 +                                is_wback || rn != 31, size);
      tcg_rt = cpu_reg(s, rt);
      do_gpr_ld(s, tcg_rt, clean_addr, size, /* is_signed */ false,
 --
-.20.1
+.34.1

-[PULL 23/57] target/arm: Implement the ADDG, SUBG instructions
+[PULL 65/72] softfloat: Move propagateFloatx80NaN to softfloat.c
 From: Richard Henderson <richard.henderson@linaro.org>
+This function is part of the public interface and
+is not "specialized" to any target in any way.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241203203949.483774-7-richard.henderson@linaro.org
 Message-id: 20200626033144.790098-12-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper-a64.h    |  1 +
+ fpu/softfloat.c                | 52 ++++++++++++++++++++++++++++++++++
- target/arm/internals.h     |  9 +++++++
+ fpu/softfloat-specialize.c.inc | 52 ----------------------------------
- target/arm/mte_helper.c    | 10 ++++++++
+files changed, 52 insertions(+), 52 deletions(-)
  target/arm/translate-a64.c | 51 ++++++++++++++++++++++++++++++++++++++
 files changed, 71 insertions(+)
-diff --git a/target/arm/helper-a64.h b/target/arm/helper-a64.h
+diff --git a/fpu/softfloat.c b/fpu/softfloat.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-a64.h
+--- a/fpu/softfloat.c
-+++ b/target/arm/helper-a64.h
++++ b/fpu/softfloat.c
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_2(xpaci, TCG_CALL_NO_RWG_SE, i64, env, i64)
+@@ -XXX,XX +XXX,XX @@ void normalizeFloatx80Subnormal(uint64_t aSig, int32_t *zExpPtr,
- DEF_HELPER_FLAGS_2(xpacd, TCG_CALL_NO_RWG_SE, i64, env, i64)
+     *zExpPtr = 1 - shiftCount;
+ }
- DEF_HELPER_FLAGS_3(irg, TCG_CALL_NO_RWG, i64, env, i64, i64)
-+DEF_HELPER_FLAGS_4(addsubg, TCG_CALL_NO_RWG_SE, i64, env, i64, s32, i32)
++/*----------------------------------------------------------------------------
-diff --git a/target/arm/internals.h b/target/arm/internals.h
++| Takes two extended double-precision floating-point values `a' and `b', one
-index XXXXXXX..XXXXXXX 100644
++| of which is a NaN, and returns the appropriate NaN result.  If either `a' or
---- a/target/arm/internals.h
++| `b' is a signaling NaN, the invalid exception is raised.
-+++ b/target/arm/internals.h
++*----------------------------------------------------------------------------*/
@@ -XXX,XX +XXX,XX @@ void arm_log_exception(int idx);
   */
  #define GMID_EL1_BS  6
 +/* We associate one allocation tag per 16 bytes, the minimum.  */
 +#define LOG2_TAG_GRANULE 4
 +#define TAG_GRANULE      (1 << LOG2_TAG_GRANULE)
 +
-+static inline int allocation_tag_from_addr(uint64_t ptr)
++floatx80 propagateFloatx80NaN(floatx80 a, floatx80 b, float_status *status)
 +{
-+    return extract64(ptr, 56, 4);
++    bool aIsLargerSignificand;
-+}
++    FloatClass a_cls, b_cls;
 +
- static inline uint64_t address_with_allocation_tag(uint64_t ptr, int rtag)
++    /* This is not complete, but is good enough for pickNaN.  */
- {
++    a_cls = (!floatx80_is_any_nan(a)
-     return deposit64(ptr, 56, 4, rtag);
++             ? float_class_normal
-diff --git a/target/arm/mte_helper.c b/target/arm/mte_helper.c
++             : floatx80_is_signaling_nan(a, status)
-index XXXXXXX..XXXXXXX 100644
++             ? float_class_snan
---- a/target/arm/mte_helper.c
++             : float_class_qnan);
-+++ b/target/arm/mte_helper.c
++    b_cls = (!floatx80_is_any_nan(b)
-@@ -XXX,XX +XXX,XX @@ uint64_t HELPER(irg)(CPUARMState *env, uint64_t rn, uint64_t rm)
++             ? float_class_normal
++             : floatx80_is_signaling_nan(b, status)
-     return address_with_allocation_tag(rn, rtag);
++             ? float_class_snan
- }
++             : float_class_qnan);
 +
-+uint64_t HELPER(addsubg)(CPUARMState *env, uint64_t ptr,
++    if (is_snan(a_cls) || is_snan(b_cls)) {
-+                         int32_t offset, uint32_t tag_offset)
++        float_raise(float_flag_invalid, status);
 +{
 +    int start_tag = allocation_tag_from_addr(ptr);
 +    uint16_t exclude = extract32(env->cp15.gcr_el1, 0, 16);
 +    int rtag = choose_nonexcluded_tag(start_tag, tag_offset, exclude);
 +
 +    return address_with_allocation_tag(ptr + offset, rtag);
 +}
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_add_sub_imm(DisasContext *s, uint32_t insn)
      tcg_temp_free_i64(tcg_result);
  }
 +/*
 + * Add/subtract (immediate, with tags)
 + *
 + *  31 30 29 28         23 22 21     16 14      10 9   5 4   0
 + * +--+--+--+-------------+--+---------+--+-------+-----+-----+
 + * |sf|op| S| 1 0 0 0 1 1 |o2|  uimm6  |o3| uimm4 |  Rn | Rd  |
 + * +--+--+--+-------------+--+---------+--+-------+-----+-----+
 + *
 + *    op: 0 -> add, 1 -> sub
 + */
 +static void disas_add_sub_imm_with_tags(DisasContext *s, uint32_t insn)
 +{
 +    int rd = extract32(insn, 0, 5);
 +    int rn = extract32(insn, 5, 5);
 +    int uimm4 = extract32(insn, 10, 4);
 +    int uimm6 = extract32(insn, 16, 6);
 +    bool sub_op = extract32(insn, 30, 1);
 +    TCGv_i64 tcg_rn, tcg_rd;
 +    int imm;
 +
 +    /* Test all of sf=1, S=0, o2=0, o3=0.  */
 +    if ((insn & 0xa040c000u) != 0x80000000u ||
 +        !dc_isar_feature(aa64_mte_insn_reg, s)) {
 +        unallocated_encoding(s);
 +        return;
 +    }
 +
-+    imm = uimm6 << LOG2_TAG_GRANULE;
++    if (status->default_nan_mode) {
-+    if (sub_op) {
++        return floatx80_default_nan(status);
 +        imm = -imm;
 +    }
 +
-+    tcg_rn = cpu_reg_sp(s, rn);
++    if (a.low < b.low) {
-+    tcg_rd = cpu_reg_sp(s, rd);
++        aIsLargerSignificand = 0;
 +    } else if (b.low < a.low) {
 +        aIsLargerSignificand = 1;
 +    } else {
 +        aIsLargerSignificand = (a.high < b.high) ? 1 : 0;
 +    }
 +
-+    if (s->ata) {
++    if (pickNaN(a_cls, b_cls, aIsLargerSignificand, status)) {
-+        TCGv_i32 offset = tcg_const_i32(imm);
++        if (is_snan(b_cls)) {
-+        TCGv_i32 tag_offset = tcg_const_i32(uimm4);
++            return floatx80_silence_nan(b, status);
-+
++        }
-+        gen_helper_addsubg(tcg_rd, cpu_env, tcg_rn, offset, tag_offset);
++        return b;
 +        tcg_temp_free_i32(tag_offset);
 +        tcg_temp_free_i32(offset);
 +    } else {
-+        tcg_gen_addi_i64(tcg_rd, tcg_rn, imm);
++        if (is_snan(a_cls)) {
-+        gen_address_with_allocation_tag0(tcg_rd, tcg_rd);
++            return floatx80_silence_nan(a, status);
 +        }
 +        return a;
 +    }
 +}
 +
- /* The input should be a value in the bottom e bits (with higher
+ /*----------------------------------------------------------------------------
-  * bits zero); returns that value replicated into every element
+ | Takes an abstract floating-point value having sign `zSign', exponent `zExp',
-  * of size e in a 64 bit integer.
+ | and extended significand formed by the concatenation of `zSig0' and `zSig1',
-@@ -XXX,XX +XXX,XX @@ static void disas_data_proc_imm(DisasContext *s, uint32_t insn)
+diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
-     case 0x22: /* Add/subtract (immediate) */
+index XXXXXXX..XXXXXXX 100644
-         disas_add_sub_imm(s, insn);
+--- a/fpu/softfloat-specialize.c.inc
-         break;
++++ b/fpu/softfloat-specialize.c.inc
-+    case 0x23: /* Add/subtract (immediate, with tags) */
+@@ -XXX,XX +XXX,XX @@ floatx80 floatx80_silence_nan(floatx80 a, float_status *status)
-+        disas_add_sub_imm_with_tags(s, insn);
+     return a;
-+        break;
+ }
-     case 0x24: /* Logical (immediate) */
-         disas_logic_imm(s, insn);
+-/*----------------------------------------------------------------------------
-         break;
+-| Takes two extended double-precision floating-point values `a' and `b', one
 -| of which is a NaN, and returns the appropriate NaN result.  If either `a' or
 -| `b' is a signaling NaN, the invalid exception is raised.
 -*----------------------------------------------------------------------------*/
 -
 -floatx80 propagateFloatx80NaN(floatx80 a, floatx80 b, float_status *status)
 -{
 -    bool aIsLargerSignificand;
 -    FloatClass a_cls, b_cls;
 -
 -    /* This is not complete, but is good enough for pickNaN.  */
 -    a_cls = (!floatx80_is_any_nan(a)
 -             ? float_class_normal
 -             : floatx80_is_signaling_nan(a, status)
 -             ? float_class_snan
 -             : float_class_qnan);
 -    b_cls = (!floatx80_is_any_nan(b)
 -             ? float_class_normal
 -             : floatx80_is_signaling_nan(b, status)
 -             ? float_class_snan
 -             : float_class_qnan);
 -
 -    if (is_snan(a_cls) || is_snan(b_cls)) {
 -        float_raise(float_flag_invalid, status);
 -    }
 -
 -    if (status->default_nan_mode) {
 -        return floatx80_default_nan(status);
 -    }
 -
 -    if (a.low < b.low) {
 -        aIsLargerSignificand = 0;
 -    } else if (b.low < a.low) {
 -        aIsLargerSignificand = 1;
 -    } else {
 -        aIsLargerSignificand = (a.high < b.high) ? 1 : 0;
 -    }
 -
 -    if (pickNaN(a_cls, b_cls, aIsLargerSignificand, status)) {
 -        if (is_snan(b_cls)) {
 -            return floatx80_silence_nan(b, status);
 -        }
 -        return b;
 -    } else {
 -        if (is_snan(a_cls)) {
 -            return floatx80_silence_nan(a, status);
 -        }
 -        return a;
 -    }
 -}
 -
  /*----------------------------------------------------------------------------
  | Returns 1 if the quadruple-precision floating-point value `a' is a quiet
  | NaN; otherwise returns 0.
 --
-.20.1
+.34.1

-[PULL 40/57] target/arm: Use mte_checkN for sve unpredicated loads
+[PULL 66/72] softfloat: Use parts_pick_nan in propagateFloatx80NaN
 From: Richard Henderson <richard.henderson@linaro.org>
+Unpacking and repacking the parts may be slightly more work
+than we did before, but we get to reuse more code.  For a
+code path handling exceptional values, this is an improvement.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241203203949.483774-8-richard.henderson@linaro.org
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20200626033144.790098-29-richard.henderson@linaro.org
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate-sve.c | 61 +++++++++++++++++++++-----------------
+ fpu/softfloat.c | 43 +++++--------------------------------------
-file changed, 33 insertions(+), 28 deletions(-)
+file changed, 5 insertions(+), 38 deletions(-)
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+diff --git a/fpu/softfloat.c b/fpu/softfloat.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
+--- a/fpu/softfloat.c
-+++ b/target/arm/translate-sve.c
++++ b/fpu/softfloat.c
-@@ -XXX,XX +XXX,XX @@ static void do_ldr(DisasContext *s, uint32_t vofs, int len, int rn, int imm)
+@@ -XXX,XX +XXX,XX @@ void normalizeFloatx80Subnormal(uint64_t aSig, int32_t *zExpPtr,
-     int len_remain = len % 8;
-     int nparts = len / 8 + ctpop8(len_remain);
+ floatx80 propagateFloatx80NaN(floatx80 a, floatx80 b, float_status *status)
-     int midx = get_mem_index(s);
+ {
--    TCGv_i64 addr, t0, t1;
+-    bool aIsLargerSignificand;
-+    TCGv_i64 dirty_addr, clean_addr, t0, t1;
+-    FloatClass a_cls, b_cls;
++    FloatParts128 pa, pb, *pr;
--    addr = tcg_temp_new_i64();
--    t0 = tcg_temp_new_i64();
+-    /* This is not complete, but is good enough for pickNaN.  */
-+    dirty_addr = tcg_temp_new_i64();
+-    a_cls = (!floatx80_is_any_nan(a)
-+    tcg_gen_addi_i64(dirty_addr, cpu_reg_sp(s, rn), imm);
+-             ? float_class_normal
-+    clean_addr = gen_mte_checkN(s, dirty_addr, false, rn != 31, len, MO_8);
+-             : floatx80_is_signaling_nan(a, status)
-+    tcg_temp_free_i64(dirty_addr);
+-             ? float_class_snan
+-             : float_class_qnan);
--    /* Note that unpredicated load/store of vector/predicate registers
+-    b_cls = (!floatx80_is_any_nan(b)
-+    /*
+-             ? float_class_normal
-+     * Note that unpredicated load/store of vector/predicate registers
+-             : floatx80_is_signaling_nan(b, status)
-      * are defined as a stream of bytes, which equates to little-endian
+-             ? float_class_snan
--     * operations on larger quantities.  There is no nice way to force
+-             : float_class_qnan);
 -     * a little-endian load for aarch64_be-linux-user out of line.
 -     *
 +     * operations on larger quantities.
       * Attempt to keep code expansion to a minimum by limiting the
       * amount of unrolling done.
       */
      if (nparts <= 4) {
          int i;
 +        t0 = tcg_temp_new_i64();
          for (i = 0; i < len_align; i += 8) {
 -            tcg_gen_addi_i64(addr, cpu_reg_sp(s, rn), imm + i);
 -            tcg_gen_qemu_ld_i64(t0, addr, midx, MO_LEQ);
 +            tcg_gen_qemu_ld_i64(t0, clean_addr, midx, MO_LEQ);
              tcg_gen_st_i64(t0, cpu_env, vofs + i);
 +            tcg_gen_addi_i64(clean_addr, cpu_reg_sp(s, rn), 8);
          }
 +        tcg_temp_free_i64(t0);
      } else {
          TCGLabel *loop = gen_new_label();
          TCGv_ptr tp, i = tcg_const_local_ptr(0);
 +        /* Copy the clean address into a local temp, live across the loop. */
 +        t0 = clean_addr;
 +        clean_addr = tcg_temp_local_new_i64();
 +        tcg_gen_mov_i64(clean_addr, t0);
 +        tcg_temp_free_i64(t0);
 +
          gen_set_label(loop);
 -        /* Minimize the number of local temps that must be re-read from
 -         * the stack each iteration.  Instead, re-compute values other
 -         * than the loop counter.
 -         */
 +        t0 = tcg_temp_new_i64();
 +        tcg_gen_qemu_ld_i64(t0, clean_addr, midx, MO_LEQ);
 +        tcg_gen_addi_i64(clean_addr, clean_addr, 8);
 +
          tp = tcg_temp_new_ptr();
 -        tcg_gen_addi_ptr(tp, i, imm);
 -        tcg_gen_extu_ptr_i64(addr, tp);
 -        tcg_gen_add_i64(addr, addr, cpu_reg_sp(s, rn));
 -
--        tcg_gen_qemu_ld_i64(t0, addr, midx, MO_LEQ);
+-    if (is_snan(a_cls) || is_snan(b_cls)) {
 -        float_raise(float_flag_invalid, status);
 -    }
 -
-         tcg_gen_add_ptr(tp, cpu_env, i);
+-    if (status->default_nan_mode) {
-         tcg_gen_addi_ptr(i, i, 8);
++    if (!floatx80_unpack_canonical(&pa, a, status) ||
-         tcg_gen_st_i64(t0, tp, vofs);
++        !floatx80_unpack_canonical(&pb, b, status)) {
-         tcg_temp_free_ptr(tp);
+         return floatx80_default_nan(status);
 +        tcg_temp_free_i64(t0);
          tcg_gen_brcondi_ptr(TCG_COND_LTU, i, len_align, loop);
          tcg_temp_free_ptr(i);
      }
--    /* Predicate register loads can be any multiple of 2.
+-    if (a.low < b.low) {
-+    /*
+-        aIsLargerSignificand = 0;
-+     * Predicate register loads can be any multiple of 2.
+-    } else if (b.low < a.low) {
-      * Note that we still store the entire 64-bit unit into cpu_env.
+-        aIsLargerSignificand = 1;
-      */
+-    } else {
-     if (len_remain) {
+-        aIsLargerSignificand = (a.high < b.high) ? 1 : 0;
--        tcg_gen_addi_i64(addr, cpu_reg_sp(s, rn), imm + len_align);
+-    }
 -
-+        t0 = tcg_temp_new_i64();
+-    if (pickNaN(a_cls, b_cls, aIsLargerSignificand, status)) {
-         switch (len_remain) {
+-        if (is_snan(b_cls)) {
-         case 2:
+-            return floatx80_silence_nan(b, status);
-         case 4:
+-        }
-         case 8:
+-        return b;
--            tcg_gen_qemu_ld_i64(t0, addr, midx, MO_LE | ctz32(len_remain));
+-    } else {
-+            tcg_gen_qemu_ld_i64(t0, clean_addr, midx,
+-        if (is_snan(a_cls)) {
-+                                MO_LE | ctz32(len_remain));
+-            return floatx80_silence_nan(a, status);
-             break;
+-        }
+-        return a;
-         case 6:
+-    }
-             t1 = tcg_temp_new_i64();
++    pr = parts_pick_nan(&pa, &pb, status);
--            tcg_gen_qemu_ld_i64(t0, addr, midx, MO_LEUL);
++    return floatx80_round_pack_canonical(pr, status);
 -            tcg_gen_addi_i64(addr, addr, 4);
 -            tcg_gen_qemu_ld_i64(t1, addr, midx, MO_LEUW);
 +            tcg_gen_qemu_ld_i64(t0, clean_addr, midx, MO_LEUL);
 +            tcg_gen_addi_i64(clean_addr, clean_addr, 4);
 +            tcg_gen_qemu_ld_i64(t1, clean_addr, midx, MO_LEUW);
              tcg_gen_deposit_i64(t0, t0, t1, 32, 32);
              tcg_temp_free_i64(t1);
              break;
@@ -XXX,XX +XXX,XX @@ static void do_ldr(DisasContext *s, uint32_t vofs, int len, int rn, int imm)
              g_assert_not_reached();
          }
          tcg_gen_st_i64(t0, cpu_env, vofs + len_align);
 +        tcg_temp_free_i64(t0);
      }
 -    tcg_temp_free_i64(addr);
 -    tcg_temp_free_i64(t0);
 +    tcg_temp_free_i64(clean_addr);
  }
- /* Similarly for stores.  */
+ /*----------------------------------------------------------------------------
 --
-.20.1
+.34.1

-[PULL 33/57] target/arm: Move regime_el to internals.h
+[PULL 67/72] softfloat: Inline pickNaN
 From: Richard Henderson <richard.henderson@linaro.org>
-We will shortly need this in mte_helper.c as well.
+Inline pickNaN into its only caller.  This makes one assert
+redundant with the immediately preceding IF.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20200626033144.790098-22-richard.henderson@linaro.org
+Reviewed-by: Philippe Mathieu-Daudé <philmd@linaro.org>
 Message-id: 20241203203949.483774-9-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/internals.h | 36 ++++++++++++++++++++++++++++++++++++
+ fpu/softfloat-parts.c.inc      | 82 +++++++++++++++++++++++++----
- target/arm/helper.c    | 36 ------------------------------------
+ fpu/softfloat-specialize.c.inc | 96 ----------------------------------
-files changed, 36 insertions(+), 36 deletions(-)
+files changed, 73 insertions(+), 105 deletions(-)
-diff --git a/target/arm/internals.h b/target/arm/internals.h
+diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/internals.h
+--- a/fpu/softfloat-parts.c.inc
-+++ b/target/arm/internals.h
++++ b/fpu/softfloat-parts.c.inc
-@@ -XXX,XX +XXX,XX @@ static inline bool regime_is_pan(CPUARMState *env, ARMMMUIdx mmu_idx)
+@@ -XXX,XX +XXX,XX @@ static void partsN(return_nan)(FloatPartsN *a, float_status *s)
  static FloatPartsN *partsN(pick_nan)(FloatPartsN *a, FloatPartsN *b,
                                       float_status *s)
  {
 +    int cmp, which;
 +
      if (is_snan(a->cls) || is_snan(b->cls)) {
          float_raise(float_flag_invalid | float_flag_invalid_snan, s);
      }
      if (s->default_nan_mode) {
          parts_default_nan(a, s);
 -    } else {
 -        int cmp = frac_cmp(a, b);
 -        if (cmp == 0) {
 -            cmp = a->sign < b->sign;
 -        }
 +        return a;
 +    }
 -        if (pickNaN(a->cls, b->cls, cmp > 0, s)) {
 -            a = b;
 -        }
 +    cmp = frac_cmp(a, b);
 +    if (cmp == 0) {
 +        cmp = a->sign < b->sign;
 +    }
 +
 +    switch (s->float_2nan_prop_rule) {
 +    case float_2nan_prop_s_ab:
          if (is_snan(a->cls)) {
 -            parts_silence_nan(a, s);
 +            which = 0;
 +        } else if (is_snan(b->cls)) {
 +            which = 1;
 +        } else if (is_qnan(a->cls)) {
 +            which = 0;
 +        } else {
 +            which = 1;
          }
 +        break;
 +    case float_2nan_prop_s_ba:
 +        if (is_snan(b->cls)) {
 +            which = 1;
 +        } else if (is_snan(a->cls)) {
 +            which = 0;
 +        } else if (is_qnan(b->cls)) {
 +            which = 1;
 +        } else {
 +            which = 0;
 +        }
 +        break;
 +    case float_2nan_prop_ab:
 +        which = is_nan(a->cls) ? 0 : 1;
 +        break;
 +    case float_2nan_prop_ba:
 +        which = is_nan(b->cls) ? 1 : 0;
 +        break;
 +    case float_2nan_prop_x87:
 +        /*
 +         * This implements x87 NaN propagation rules:
 +         * SNaN + QNaN => return the QNaN
 +         * two SNaNs => return the one with the larger significand, silenced
 +         * two QNaNs => return the one with the larger significand
 +         * SNaN and a non-NaN => return the SNaN, silenced
 +         * QNaN and a non-NaN => return the QNaN
 +         *
 +         * If we get down to comparing significands and they are the same,
 +         * return the NaN with the positive sign bit (if any).
 +         */
 +        if (is_snan(a->cls)) {
 +            if (is_snan(b->cls)) {
 +                which = cmp > 0 ? 0 : 1;
 +            } else {
 +                which = is_qnan(b->cls) ? 1 : 0;
 +            }
 +        } else if (is_qnan(a->cls)) {
 +            if (is_snan(b->cls) || !is_qnan(b->cls)) {
 +                which = 0;
 +            } else {
 +                which = cmp > 0 ? 0 : 1;
 +            }
 +        } else {
 +            which = 1;
 +        }
 +        break;
 +    default:
 +        g_assert_not_reached();
 +    }
 +
 +    if (which) {
 +        a = b;
 +    }
 +    if (is_snan(a->cls)) {
 +        parts_silence_nan(a, s);
      }
      return a;
  }
 diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
 index XXXXXXX..XXXXXXX 100644
 --- a/fpu/softfloat-specialize.c.inc
 +++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ bool float32_is_signaling_nan(float32 a_, float_status *status)
      }
  }
-+/* Return the exception level which controls this address translation regime */
+-/*----------------------------------------------------------------------------
-+static inline uint32_t regime_el(CPUARMState *env, ARMMMUIdx mmu_idx)
+-| Select which NaN to propagate for a two-input operation.
-+{
+-| IEEE754 doesn't specify all the details of this, so the
-+    switch (mmu_idx) {
+-| algorithm is target-specific.
-+    case ARMMMUIdx_E20_0:
+-| The routine is passed various bits of information about the
-+    case ARMMMUIdx_E20_2:
+-| two NaNs and should return 0 to select NaN a and 1 for NaN b.
-+    case ARMMMUIdx_E20_2_PAN:
+-| Note that signalling NaNs are always squashed to quiet NaNs
-+    case ARMMMUIdx_Stage2:
+-| by the caller, by calling floatXX_silence_nan() before
-+    case ARMMMUIdx_E2:
+-| returning them.
-+        return 2;
+-|
-+    case ARMMMUIdx_SE3:
+-| aIsLargerSignificand is only valid if both a and b are NaNs
-+        return 3;
+-| of some kind, and is true if a has the larger significand,
-+    case ARMMMUIdx_SE10_0:
+-| or if both a and b have the same significand but a is
-+        return arm_el_is_aa64(env, 3) ? 1 : 3;
+-| positive but b is negative. It is only needed for the x87
-+    case ARMMMUIdx_SE10_1:
+-| tie-break rule.
-+    case ARMMMUIdx_SE10_1_PAN:
+-*----------------------------------------------------------------------------*/
-+    case ARMMMUIdx_Stage1_E0:
+-
-+    case ARMMMUIdx_Stage1_E1:
+-static int pickNaN(FloatClass a_cls, FloatClass b_cls,
-+    case ARMMMUIdx_Stage1_E1_PAN:
+-                   bool aIsLargerSignificand, float_status *status)
 +    case ARMMMUIdx_E10_0:
 +    case ARMMMUIdx_E10_1:
 +    case ARMMMUIdx_E10_1_PAN:
 +    case ARMMMUIdx_MPrivNegPri:
 +    case ARMMMUIdx_MUserNegPri:
 +    case ARMMMUIdx_MPriv:
 +    case ARMMMUIdx_MUser:
 +    case ARMMMUIdx_MSPrivNegPri:
 +    case ARMMMUIdx_MSUserNegPri:
 +    case ARMMMUIdx_MSPriv:
 +    case ARMMMUIdx_MSUser:
 +        return 1;
 +    default:
 +        g_assert_not_reached();
 +    }
 +}
 +
  /* Return the FSR value for a debug exception (watchpoint, hardware
   * breakpoint or BKPT insn) targeting the specified exception level.
   */
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void arm_cpu_do_interrupt(CPUState *cs)
  }
  #endif /* !CONFIG_USER_ONLY */
 -/* Return the exception level which controls this address translation regime */
 -static uint32_t regime_el(CPUARMState *env, ARMMMUIdx mmu_idx)
 -{
--    switch (mmu_idx) {
+-    /*
--    case ARMMMUIdx_E20_0:
+-     * We guarantee not to require the target to tell us how to
--    case ARMMMUIdx_E20_2:
+-     * pick a NaN if we're always returning the default NaN.
--    case ARMMMUIdx_E20_2_PAN:
+-     * But if we're not in default-NaN mode then the target must
--    case ARMMMUIdx_Stage2:
+-     * specify via set_float_2nan_prop_rule().
--    case ARMMMUIdx_E2:
+-     */
--        return 2;
+-    assert(!status->default_nan_mode);
--    case ARMMMUIdx_SE3:
+-
--        return 3;
+-    switch (status->float_2nan_prop_rule) {
--    case ARMMMUIdx_SE10_0:
+-    case float_2nan_prop_s_ab:
--        return arm_el_is_aa64(env, 3) ? 1 : 3;
+-        if (is_snan(a_cls)) {
--    case ARMMMUIdx_SE10_1:
+-            return 0;
--    case ARMMMUIdx_SE10_1_PAN:
+-        } else if (is_snan(b_cls)) {
--    case ARMMMUIdx_Stage1_E0:
+-            return 1;
--    case ARMMMUIdx_Stage1_E1:
+-        } else if (is_qnan(a_cls)) {
--    case ARMMMUIdx_Stage1_E1_PAN:
+-            return 0;
--    case ARMMMUIdx_E10_0:
+-        } else {
--    case ARMMMUIdx_E10_1:
+-            return 1;
--    case ARMMMUIdx_E10_1_PAN:
+-        }
--    case ARMMMUIdx_MPrivNegPri:
+-        break;
--    case ARMMMUIdx_MUserNegPri:
+-    case float_2nan_prop_s_ba:
--    case ARMMMUIdx_MPriv:
+-        if (is_snan(b_cls)) {
--    case ARMMMUIdx_MUser:
+-            return 1;
--    case ARMMMUIdx_MSPrivNegPri:
+-        } else if (is_snan(a_cls)) {
--    case ARMMMUIdx_MSUserNegPri:
+-            return 0;
--    case ARMMMUIdx_MSPriv:
+-        } else if (is_qnan(b_cls)) {
--    case ARMMMUIdx_MSUser:
+-            return 1;
--        return 1;
+-        } else {
 -            return 0;
 -        }
 -        break;
 -    case float_2nan_prop_ab:
 -        if (is_nan(a_cls)) {
 -            return 0;
 -        } else {
 -            return 1;
 -        }
 -        break;
 -    case float_2nan_prop_ba:
 -        if (is_nan(b_cls)) {
 -            return 1;
 -        } else {
 -            return 0;
 -        }
 -        break;
 -    case float_2nan_prop_x87:
 -        /*
 -         * This implements x87 NaN propagation rules:
 -         * SNaN + QNaN => return the QNaN
 -         * two SNaNs => return the one with the larger significand, silenced
 -         * two QNaNs => return the one with the larger significand
 -         * SNaN and a non-NaN => return the SNaN, silenced
 -         * QNaN and a non-NaN => return the QNaN
 -         *
 -         * If we get down to comparing significands and they are the same,
 -         * return the NaN with the positive sign bit (if any).
 -         */
 -        if (is_snan(a_cls)) {
 -            if (is_snan(b_cls)) {
 -                return aIsLargerSignificand ? 0 : 1;
 -            }
 -            return is_qnan(b_cls) ? 1 : 0;
 -        } else if (is_qnan(a_cls)) {
 -            if (is_snan(b_cls) || !is_qnan(b_cls)) {
 -                return 0;
 -            } else {
 -                return aIsLargerSignificand ? 0 : 1;
 -            }
 -        } else {
 -            return 1;
 -        }
 -    default:
 -        g_assert_not_reached();
 -    }
 -}
 -
- uint64_t arm_sctlr(CPUARMState *env, int el)
+ /*----------------------------------------------------------------------------
- {
+ | Returns 1 if the double-precision floating-point value `a' is a quiet
-     /* Only EL0 needs to be adjusted for EL1&0 or EL2&0. */
+ | NaN; otherwise returns 0.
 --
-.20.1
+.34.1

-[PULL 25/57] target/arm: Implement the SUBP instruction
+[PULL 68/72] softfloat: Share code between parts_pick_nan cases
 From: Richard Henderson <richard.henderson@linaro.org>
+Remember if there was an SNaN, and use that to simplify
+float_2nan_prop_s_{ab,ba} to only the snan component.
+Then, fall through to the corresponding
+float_2nan_prop_{ab,ba} case to handle any remaining
+nans, which must be quiet.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241203203949.483774-10-richard.henderson@linaro.org
 Message-id: 20200626033144.790098-14-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate-a64.c | 24 ++++++++++++++++++++++--
+ fpu/softfloat-parts.c.inc | 32 ++++++++++++--------------------
-file changed, 22 insertions(+), 2 deletions(-)
+file changed, 12 insertions(+), 20 deletions(-)
-diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
+diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-a64.c
+--- a/fpu/softfloat-parts.c.inc
-+++ b/target/arm/translate-a64.c
++++ b/fpu/softfloat-parts.c.inc
-@@ -XXX,XX +XXX,XX @@ static void handle_crc32(DisasContext *s,
+@@ -XXX,XX +XXX,XX @@ static void partsN(return_nan)(FloatPartsN *a, float_status *s)
-  */
+ static FloatPartsN *partsN(pick_nan)(FloatPartsN *a, FloatPartsN *b,
- static void disas_data_proc_2src(DisasContext *s, uint32_t insn)
+                                      float_status *s)
  {
--    unsigned int sf, rm, opcode, rn, rd;
++    bool have_snan = false;
-+    unsigned int sf, rm, opcode, rn, rd, setflag;
+     int cmp, which;
-     sf = extract32(insn, 31, 1);
-+    setflag = extract32(insn, 29, 1);
+     if (is_snan(a->cls) || is_snan(b->cls)) {
-     rm = extract32(insn, 16, 5);
+         float_raise(float_flag_invalid | float_flag_invalid_snan, s);
-     opcode = extract32(insn, 10, 6);
++        have_snan = true;
      rn = extract32(insn, 5, 5);
      rd = extract32(insn, 0, 5);
 -    if (extract32(insn, 29, 1)) {
 +    if (setflag && opcode != 0) {
          unallocated_encoding(s);
          return;
      }
-     switch (opcode) {
+     if (s->default_nan_mode) {
-+    case 0: /* SUBP(S) */
+@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan)(FloatPartsN *a, FloatPartsN *b,
-+        if (sf == 0 || !dc_isar_feature(aa64_mte_insn_reg, s)) {
-+            goto do_unallocated;
+     switch (s->float_2nan_prop_rule) {
-+        } else {
+     case float_2nan_prop_s_ab:
-+            TCGv_i64 tcg_n, tcg_m, tcg_d;
+-        if (is_snan(a->cls)) {
-+
+-            which = 0;
-+            tcg_n = read_cpu_reg_sp(s, rn, true);
+-        } else if (is_snan(b->cls)) {
-+            tcg_m = read_cpu_reg_sp(s, rm, true);
+-            which = 1;
-+            tcg_gen_sextract_i64(tcg_n, tcg_n, 0, 56);
+-        } else if (is_qnan(a->cls)) {
-+            tcg_gen_sextract_i64(tcg_m, tcg_m, 0, 56);
+-            which = 0;
-+            tcg_d = cpu_reg(s, rd);
+-        } else {
-+
+-            which = 1;
-+            if (setflag) {
++        if (have_snan) {
-+                gen_sub_CC(true, tcg_d, tcg_n, tcg_m);
++            which = is_snan(a->cls) ? 0 : 1;
-+            } else {
++            break;
-+                tcg_gen_sub_i64(tcg_d, tcg_n, tcg_m);
+         }
-+            }
+-        break;
 -    case float_2nan_prop_s_ba:
 -        if (is_snan(b->cls)) {
 -            which = 1;
 -        } else if (is_snan(a->cls)) {
 -            which = 0;
 -        } else if (is_qnan(b->cls)) {
 -            which = 1;
 -        } else {
 -            which = 0;
 -        }
 -        break;
 +        /* fall through */
      case float_2nan_prop_ab:
          which = is_nan(a->cls) ? 0 : 1;
          break;
 +    case float_2nan_prop_s_ba:
 +        if (have_snan) {
 +            which = is_snan(b->cls) ? 1 : 0;
 +            break;
 +        }
-+        break;
++        /* fall through */
-     case 2: /* UDIV */
+     case float_2nan_prop_ba:
-         handle_div(s, false, sf, rm, rn, rd);
+         which = is_nan(b->cls) ? 1 : 0;
          break;
 --
-.20.1
+.34.1

-[PULL 15/57] target/arm: Add support for MTE to SCTLR_ELx
+[PULL 69/72] softfloat: Sink frac_cmp in parts_pick_nan until needed
 From: Richard Henderson <richard.henderson@linaro.org>
-This does not attempt to rectify all of the res0 bits, but does
+Move the fractional comparison to the end of the
-clear the mte bits when not enabled.  Since there is no high-part
+float_2nan_prop_x87 case.  This is not required for
-mapping of SCTLR, aa32 mode cannot write to these bits.
+any other 2nan propagation rule.  Reorganize the
 x87 case itself to break out of the switch when the
 fractional comparison is not required.
+Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20241203203949.483774-11-richard.henderson@linaro.org
 Message-id: 20200626033144.790098-4-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper.c | 23 +++++++++++++++++------
+ fpu/softfloat-parts.c.inc | 19 +++++++++----------
-file changed, 17 insertions(+), 6 deletions(-)
+file changed, 9 insertions(+), 10 deletions(-)
-diff --git a/target/arm/helper.c b/target/arm/helper.c
+diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.c
+--- a/fpu/softfloat-parts.c.inc
-+++ b/target/arm/helper.c
++++ b/fpu/softfloat-parts.c.inc
-@@ -XXX,XX +XXX,XX @@ static void sctlr_write(CPUARMState *env, const ARMCPRegInfo *ri,
+@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan)(FloatPartsN *a, FloatPartsN *b,
- {
+         return a;
      ARMCPU *cpu = env_archcpu(env);
 +    if (arm_feature(env, ARM_FEATURE_PMSA) && !cpu->has_mpu) {
 +        /* M bit is RAZ/WI for PMSA with no MPU implemented */
 +        value &= ~SCTLR_M;
 +    }
 +
 +    /* ??? Lots of these bits are not implemented.  */
 +
 +    if (ri->state == ARM_CP_STATE_AA64 && !cpu_isar_feature(aa64_mte, cpu)) {
 +        if (ri->opc1 == 6) { /* SCTLR_EL3 */
 +            value &= ~(SCTLR_ITFSB | SCTLR_TCF | SCTLR_ATA);
 +        } else {
 +            value &= ~(SCTLR_ITFSB | SCTLR_TCF0 | SCTLR_TCF |
 +                       SCTLR_ATA0 | SCTLR_ATA);
 +        }
 +    }
 +
      if (raw_read(env, ri) == value) {
          /* Skip the TLB flush if nothing actually changed; Linux likes
           * to do a lot of pointless SCTLR writes.
@@ -XXX,XX +XXX,XX @@ static void sctlr_write(CPUARMState *env, const ARMCPRegInfo *ri,
          return;
      }
--    if (arm_feature(env, ARM_FEATURE_PMSA) && !cpu->has_mpu) {
+-    cmp = frac_cmp(a, b);
--        /* M bit is RAZ/WI for PMSA with no MPU implemented */
+-    if (cmp == 0) {
--        value &= ~SCTLR_M;
+-        cmp = a->sign < b->sign;
 -    }
 -
-     raw_write(env, ri, value);
+     switch (s->float_2nan_prop_rule) {
--    /* ??? Lots of these bits are not implemented.  */
+     case float_2nan_prop_s_ab:
-+
+         if (have_snan) {
-     /* This may enable/disable the MMU, so do a TLB flush.  */
+@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan)(FloatPartsN *a, FloatPartsN *b,
-     tlb_flush(CPU(cpu));
+          * return the NaN with the positive sign bit (if any).
+          */
          if (is_snan(a->cls)) {
 -            if (is_snan(b->cls)) {
 -                which = cmp > 0 ? 0 : 1;
 -            } else {
 +            if (!is_snan(b->cls)) {
                  which = is_qnan(b->cls) ? 1 : 0;
 +                break;
              }
          } else if (is_qnan(a->cls)) {
              if (is_snan(b->cls) || !is_qnan(b->cls)) {
                  which = 0;
 -            } else {
 -                which = cmp > 0 ? 0 : 1;
 +                break;
              }
          } else {
              which = 1;
 +            break;
          }
 +        cmp = frac_cmp(a, b);
 +        if (cmp == 0) {
 +            cmp = a->sign < b->sign;
 +        }
 +        which = cmp > 0 ? 0 : 1;
          break;
      default:
          g_assert_not_reached();
 --
-.20.1
+.34.1

-[PULL 49/57] target/arm: Add mte helpers for sve scatter/gather memory ops
+[PULL 70/72] softfloat: Replace WHICH with RET in parts_pick_nan
 From: Richard Henderson <richard.henderson@linaro.org>
-Because the elements are non-sequential, we cannot eliminate many
+Replace the "index" selecting between A and B with a result variable
-tests straight away like we can for sequential operations.  But
+of the proper type.  This improves clarity within the function.
 we often have the PTE details handy, so we can test for Tagged.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20200626033144.790098-38-richard.henderson@linaro.org
+Reviewed-by: Philippe Mathieu-Daudé <philmd@linaro.org>
 Message-id: 20241203203949.483774-12-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper-sve.h    | 285 ++++++++++++++++
+ fpu/softfloat-parts.c.inc | 28 +++++++++++++---------------
- target/arm/sve_helper.c    | 185 +++++++++--
+file changed, 13 insertions(+), 15 deletions(-)
  target/arm/translate-sve.c | 650 +++++++++++++++++++++++++------------
 files changed, 872 insertions(+), 248 deletions(-)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
+diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
+--- a/fpu/softfloat-parts.c.inc
-+++ b/target/arm/helper-sve.h
++++ b/fpu/softfloat-parts.c.inc
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_6(sve_ldsds_le_zd, TCG_CALL_NO_WG,
+@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan)(FloatPartsN *a, FloatPartsN *b,
- DEF_HELPER_FLAGS_6(sve_ldsds_be_zd, TCG_CALL_NO_WG,
+                                      float_status *s)
                     void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldbsu_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhsu_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhsu_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldss_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldss_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldbss_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhss_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhss_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_ldbsu_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhsu_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhsu_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldss_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldss_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldbss_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhss_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhss_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_ldbdu_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhdu_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhdu_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsdu_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsdu_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_lddd_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_lddd_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldbds_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhds_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhds_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsds_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsds_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_ldbdu_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhdu_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhdu_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsdu_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsdu_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_lddd_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_lddd_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldbds_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhds_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhds_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsds_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsds_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_ldbdu_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhdu_le_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhdu_be_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsdu_le_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsdu_be_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_lddd_le_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_lddd_be_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldbds_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhds_le_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhds_be_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsds_le_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsds_be_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
  DEF_HELPER_FLAGS_6(sve_ldffbsu_zsu, TCG_CALL_NO_WG,
                     void, env, ptr, ptr, ptr, tl, i32)
  DEF_HELPER_FLAGS_6(sve_ldffhsu_le_zsu, TCG_CALL_NO_WG,
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_6(sve_ldffsds_le_zd, TCG_CALL_NO_WG,
  DEF_HELPER_FLAGS_6(sve_ldffsds_be_zd, TCG_CALL_NO_WG,
                     void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffbsu_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhsu_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhsu_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffss_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffss_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffbss_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhss_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhss_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_ldffbsu_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhsu_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhsu_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffss_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffss_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffbss_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhss_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhss_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_ldffbdu_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhdu_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhdu_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsdu_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsdu_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffdd_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffdd_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffbds_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhds_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhds_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsds_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsds_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_ldffbdu_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhdu_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhdu_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsdu_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsdu_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffdd_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffdd_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffbds_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhds_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhds_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsds_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsds_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_ldffbdu_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhdu_le_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhdu_be_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsdu_le_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsdu_be_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffdd_le_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffdd_be_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffbds_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhds_le_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhds_be_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsds_le_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsds_be_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
  DEF_HELPER_FLAGS_6(sve_stbs_zsu, TCG_CALL_NO_WG,
                     void, env, ptr, ptr, ptr, tl, i32)
  DEF_HELPER_FLAGS_6(sve_sths_le_zsu, TCG_CALL_NO_WG,
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_6(sve_stdd_le_zd, TCG_CALL_NO_WG,
  DEF_HELPER_FLAGS_6(sve_stdd_be_zd, TCG_CALL_NO_WG,
                     void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_stbs_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_sths_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_sths_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_stss_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_stss_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_stbs_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_sths_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_sths_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_stss_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_stss_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_stbd_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_sthd_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_sthd_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_stsd_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_stsd_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_stdd_le_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_stdd_be_zsu_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_stbd_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_sthd_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_sthd_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_stsd_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_stsd_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_stdd_le_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_stdd_be_zss_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_stbd_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_sthd_le_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_sthd_be_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_stsd_le_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_stsd_be_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_stdd_le_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_stdd_be_zd_mte, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
  DEF_HELPER_FLAGS_4(sve2_pmull_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
 diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve_helper.c
 +++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ static target_ulong off_zd_d(void *reg, intptr_t reg_ofs)
  static inline QEMU_ALWAYS_INLINE
  void sve_ld1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
                 target_ulong base, uint32_t desc, uintptr_t retaddr,
 -               int esize, int msize, zreg_off_fn *off_fn,
 +               uint32_t mtedesc, int esize, int msize,
 +               zreg_off_fn *off_fn,
                 sve_ldst1_host_fn *host_fn,
                 sve_ldst1_tlb_fn *tlb_fn)
  {
-@@ -XXX,XX +XXX,XX @@ void sve_ld1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
+     bool have_snan = false;
-                         cpu_check_watchpoint(env_cpu(env), addr, msize,
+-    int cmp, which;
-                                              info.attrs, BP_MEM_READ, retaddr);
++    FloatPartsN *ret;
-                     }
++    int cmp;
--                    /* TODO: MTE check */
-+                    if (mtedesc && arm_tlb_mte_tagged(&info.attrs)) {
+     if (is_snan(a->cls) || is_snan(b->cls)) {
-+                        mte_check1(env, mtedesc, addr, retaddr);
+         float_raise(float_flag_invalid | float_flag_invalid_snan, s);
-+                    }
+@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan)(FloatPartsN *a, FloatPartsN *b,
-                     host_fn(&scratch, reg_off, info.host);
+     switch (s->float_2nan_prop_rule) {
-                 } else {
+     case float_2nan_prop_s_ab:
-                     /* Element crosses the page boundary. */
+         if (have_snan) {
-@@ -XXX,XX +XXX,XX @@ void sve_ld1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
+-            which = is_snan(a->cls) ? 0 : 1;
-                                              msize, info.attrs,
++            ret = is_snan(a->cls) ? a : b;
-                                              BP_MEM_READ, retaddr);
+             break;
-                     }
+         }
--                    /* TODO: MTE check */
+         /* fall through */
-+                    if (mtedesc && arm_tlb_mte_tagged(&info.attrs)) {
+     case float_2nan_prop_ab:
-+                        mte_check1(env, mtedesc, addr, retaddr);
+-        which = is_nan(a->cls) ? 0 : 1;
-+                    }
++        ret = is_nan(a->cls) ? a : b;
-                     tlb_fn(env, &scratch, reg_off, addr, retaddr);
+         break;
-                 }
+     case float_2nan_prop_s_ba:
          if (have_snan) {
 -            which = is_snan(b->cls) ? 1 : 0;
 +            ret = is_snan(b->cls) ? b : a;
              break;
          }
          /* fall through */
      case float_2nan_prop_ba:
 -        which = is_nan(b->cls) ? 1 : 0;
 +        ret = is_nan(b->cls) ? b : a;
          break;
      case float_2nan_prop_x87:
          /*
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan)(FloatPartsN *a, FloatPartsN *b,
           */
          if (is_snan(a->cls)) {
              if (!is_snan(b->cls)) {
 -                which = is_qnan(b->cls) ? 1 : 0;
 +                ret = is_qnan(b->cls) ? b : a;
                  break;
              }
-@@ -XXX,XX +XXX,XX @@ void sve_ld1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
+         } else if (is_qnan(a->cls)) {
-     memcpy(vd, &scratch, reg_max);
+             if (is_snan(b->cls) || !is_qnan(b->cls)) {
- }
+-                which = 0;
++                ret = a;
-+static inline QEMU_ALWAYS_INLINE
+                 break;
 +void sve_ld1_z_mte(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
 +                   target_ulong base, uint32_t desc, uintptr_t retaddr,
 +                   int esize, int msize, zreg_off_fn *off_fn,
 +                   sve_ldst1_host_fn *host_fn,
 +                   sve_ldst1_tlb_fn *tlb_fn)
 +{
 +    uint32_t mtedesc = desc >> (SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
 +    /* Remove mtedesc from the normal sve descriptor. */
 +    desc = extract32(desc, 0, SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
 +
 +    /*
 +     * ??? TODO: For the 32-bit offset extractions, base + ofs cannot
 +     * offset base entirely over the address space hole to change the
 +     * pointer tag, or change the bit55 selector.  So we could here
 +     * examine TBI + TCMA like we do for sve_ldN_r_mte().
 +     */
 +    sve_ld1_z(env, vd, vg, vm, base, desc, retaddr, mtedesc,
 +              esize, msize, off_fn, host_fn, tlb_fn);
 +}
 +
  #define DO_LD1_ZPZ_S(MEM, OFS, MSZ) \
  void HELPER(sve_ld##MEM##_##OFS)(CPUARMState *env, void *vd, void *vg,       \
                                   void *vm, target_ulong base, uint32_t desc) \
  {                                                                            \
 -    sve_ld1_z(env, vd, vg, vm, base, desc, GETPC(), 4, 1 << MSZ,             \
 +    sve_ld1_z(env, vd, vg, vm, base, desc, GETPC(), 0, 4, 1 << MSZ,          \
                off_##OFS##_s, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb);       \
 +}                                                                            \
 +void HELPER(sve_ld##MEM##_##OFS##_mte)(CPUARMState *env, void *vd, void *vg, \
 +     void *vm, target_ulong base, uint32_t desc)                             \
 +{                                                                            \
 +    sve_ld1_z_mte(env, vd, vg, vm, base, desc, GETPC(), 4, 1 << MSZ,         \
 +                  off_##OFS##_s, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb);   \
  }
  #define DO_LD1_ZPZ_D(MEM, OFS, MSZ) \
  void HELPER(sve_ld##MEM##_##OFS)(CPUARMState *env, void *vd, void *vg,       \
                                   void *vm, target_ulong base, uint32_t desc) \
  {                                                                            \
 -    sve_ld1_z(env, vd, vg, vm, base, desc, GETPC(), 8, 1 << MSZ,             \
 +    sve_ld1_z(env, vd, vg, vm, base, desc, GETPC(), 0, 8, 1 << MSZ,          \
                off_##OFS##_d, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb);       \
 +}                                                                            \
 +void HELPER(sve_ld##MEM##_##OFS##_mte)(CPUARMState *env, void *vd, void *vg, \
 +    void *vm, target_ulong base, uint32_t desc)                              \
 +{                                                                            \
 +    sve_ld1_z_mte(env, vd, vg, vm, base, desc, GETPC(), 8, 1 << MSZ,         \
 +                  off_##OFS##_d, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb);   \
  }
  DO_LD1_ZPZ_S(bsu, zsu, MO_8)
@@ -XXX,XX +XXX,XX @@ DO_LD1_ZPZ_D(dd_be, zd, MO_64)
  static inline QEMU_ALWAYS_INLINE
  void sve_ldff1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
                   target_ulong base, uint32_t desc, uintptr_t retaddr,
 -                 const int esz, const int msz, zreg_off_fn *off_fn,
 +                 uint32_t mtedesc, const int esz, const int msz,
 +                 zreg_off_fn *off_fn,
                   sve_ldst1_host_fn *host_fn,
                   sve_ldst1_tlb_fn *tlb_fn)
  {
@@ -XXX,XX +XXX,XX @@ void sve_ldff1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
       * Probe the first element, allowing faults.
       */
      addr = base + (off_fn(vm, reg_off) << scale);
 +    if (mtedesc) {
 +        mte_check1(env, mtedesc, addr, retaddr);
 +    }
      tlb_fn(env, vd, reg_off, addr, retaddr);
      /* After any fault, zero the other elements. */
@@ -XXX,XX +XXX,XX @@ void sve_ldff1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
                       (env_cpu(env), addr, msize) & BP_MEM_READ)) {
                      goto fault;
                  }
 -                /* TODO: MTE check. */
 +                if (mtedesc &&
 +                    arm_tlb_mte_tagged(&info.attrs) &&
 +                    !mte_probe1(env, mtedesc, addr)) {
 +                    goto fault;
 +                }
                  host_fn(vd, reg_off, info.host);
              }
-@@ -XXX,XX +XXX,XX @@ void sve_ldff1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
+         } else {
-     record_fault(env, reg_off, reg_max);
+-            which = 1;
- }
++            ret = b;
+             break;
--#define DO_LDFF1_ZPZ_S(MEM, OFS, MSZ) \
+         }
--void HELPER(sve_ldff##MEM##_##OFS)(CPUARMState *env, void *vd, void *vg,       \
+         cmp = frac_cmp(a, b);
--                                   void *vm, target_ulong base, uint32_t desc) \
+         if (cmp == 0) {
--{                                                                              \
+             cmp = a->sign < b->sign;
--    sve_ldff1_z(env, vd, vg, vm, base, desc, GETPC(), MO_32, MSZ,              \
+         }
--                off_##OFS##_s, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb);       \
+-        which = cmp > 0 ? 0 : 1;
-+static inline QEMU_ALWAYS_INLINE
++        ret = cmp > 0 ? a : b;
 +void sve_ldff1_z_mte(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
 +                     target_ulong base, uint32_t desc, uintptr_t retaddr,
 +                     const int esz, const int msz,
 +                     zreg_off_fn *off_fn,
 +                     sve_ldst1_host_fn *host_fn,
 +                     sve_ldst1_tlb_fn *tlb_fn)
 +{
 +    uint32_t mtedesc = desc >> (SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
 +    /* Remove mtedesc from the normal sve descriptor. */
 +    desc = extract32(desc, 0, SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
 +
 +    /*
 +     * ??? TODO: For the 32-bit offset extractions, base + ofs cannot
 +     * offset base entirely over the address space hole to change the
 +     * pointer tag, or change the bit55 selector.  So we could here
 +     * examine TBI + TCMA like we do for sve_ldN_r_mte().
 +     */
 +    sve_ldff1_z(env, vd, vg, vm, base, desc, retaddr, mtedesc,
 +                esz, msz, off_fn, host_fn, tlb_fn);
  }
 -#define DO_LDFF1_ZPZ_D(MEM, OFS, MSZ) \
 -void HELPER(sve_ldff##MEM##_##OFS)(CPUARMState *env, void *vd, void *vg,       \
 -                                   void *vm, target_ulong base, uint32_t desc) \
 -{                                                                              \
 -    sve_ldff1_z(env, vd, vg, vm, base, desc, GETPC(), MO_64, MSZ,              \
 -                off_##OFS##_d, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb);       \
 +#define DO_LDFF1_ZPZ_S(MEM, OFS, MSZ)                                   \
 +void HELPER(sve_ldff##MEM##_##OFS)                                      \
 +    (CPUARMState *env, void *vd, void *vg,                              \
 +     void *vm, target_ulong base, uint32_t desc)                        \
 +{                                                                       \
 +    sve_ldff1_z(env, vd, vg, vm, base, desc, GETPC(), 0, MO_32, MSZ,    \
 +                off_##OFS##_s, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb); \
 +}                                                                       \
 +void HELPER(sve_ldff##MEM##_##OFS##_mte)                                \
 +    (CPUARMState *env, void *vd, void *vg,                              \
 +     void *vm, target_ulong base, uint32_t desc)                        \
 +{                                                                       \
 +    sve_ldff1_z_mte(env, vd, vg, vm, base, desc, GETPC(), MO_32, MSZ,   \
 +                    off_##OFS##_s, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb); \
 +}
 +
 +#define DO_LDFF1_ZPZ_D(MEM, OFS, MSZ)                                   \
 +void HELPER(sve_ldff##MEM##_##OFS)                                      \
 +    (CPUARMState *env, void *vd, void *vg,                              \
 +     void *vm, target_ulong base, uint32_t desc)                        \
 +{                                                                       \
 +    sve_ldff1_z(env, vd, vg, vm, base, desc, GETPC(), 0, MO_64, MSZ,    \
 +                off_##OFS##_d, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb); \
 +}                                                                       \
 +void HELPER(sve_ldff##MEM##_##OFS##_mte)                                \
 +    (CPUARMState *env, void *vd, void *vg,                              \
 +     void *vm, target_ulong base, uint32_t desc)                        \
 +{                                                                       \
 +    sve_ldff1_z_mte(env, vd, vg, vm, base, desc, GETPC(), MO_64, MSZ,   \
 +                    off_##OFS##_d, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb); \
  }
  DO_LDFF1_ZPZ_S(bsu, zsu, MO_8)
@@ -XXX,XX +XXX,XX @@ DO_LDFF1_ZPZ_D(dd_be, zd, MO_64)
  static inline QEMU_ALWAYS_INLINE
  void sve_st1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
                 target_ulong base, uint32_t desc, uintptr_t retaddr,
 -               int esize, int msize, zreg_off_fn *off_fn,
 +               uint32_t mtedesc, int esize, int msize,
 +               zreg_off_fn *off_fn,
                 sve_ldst1_host_fn *host_fn,
                 sve_ldst1_tlb_fn *tlb_fn)
  {
@@ -XXX,XX +XXX,XX @@ void sve_st1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
                      cpu_check_watchpoint(env_cpu(env), addr, msize,
                                           info.attrs, BP_MEM_WRITE, retaddr);
                  }
 -                /* TODO: MTE check. */
 +
 +                if (mtedesc && arm_tlb_mte_tagged(&info.attrs)) {
 +                    mte_check1(env, mtedesc, addr, retaddr);
 +                }
              }
              i += 1;
              reg_off += esize;
@@ -XXX,XX +XXX,XX @@ void sve_st1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
      } while (reg_off < reg_max);
  }
 -#define DO_ST1_ZPZ_S(MEM, OFS, MSZ) \
 -void HELPER(sve_st##MEM##_##OFS)(CPUARMState *env, void *vd, void *vg,       \
 -                                 void *vm, target_ulong base, uint32_t desc) \
 -{                                                                            \
 -    sve_st1_z(env, vd, vg, vm, base, desc, GETPC(), 4, 1 << MSZ,             \
 -              off_##OFS##_s, sve_st1##MEM##_host, sve_st1##MEM##_tlb);       \
 +static inline QEMU_ALWAYS_INLINE
 +void sve_st1_z_mte(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
 +                   target_ulong base, uint32_t desc, uintptr_t retaddr,
 +                   int esize, int msize, zreg_off_fn *off_fn,
 +                   sve_ldst1_host_fn *host_fn,
 +                   sve_ldst1_tlb_fn *tlb_fn)
 +{
 +    uint32_t mtedesc = desc >> (SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
 +    /* Remove mtedesc from the normal sve descriptor. */
 +    desc = extract32(desc, 0, SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
 +
 +    /*
 +     * ??? TODO: For the 32-bit offset extractions, base + ofs cannot
 +     * offset base entirely over the address space hole to change the
 +     * pointer tag, or change the bit55 selector.  So we could here
 +     * examine TBI + TCMA like we do for sve_ldN_r_mte().
 +     */
 +    sve_st1_z(env, vd, vg, vm, base, desc, retaddr, mtedesc,
 +              esize, msize, off_fn, host_fn, tlb_fn);
  }
 -#define DO_ST1_ZPZ_D(MEM, OFS, MSZ) \
 -void HELPER(sve_st##MEM##_##OFS)(CPUARMState *env, void *vd, void *vg,       \
 +#define DO_ST1_ZPZ_S(MEM, OFS, MSZ)                                     \
 +void HELPER(sve_st##MEM##_##OFS)(CPUARMState *env, void *vd, void *vg,  \
                                   void *vm, target_ulong base, uint32_t desc) \
 -{                                                                            \
 -    sve_st1_z(env, vd, vg, vm, base, desc, GETPC(), 8, 1 << MSZ,             \
 -              off_##OFS##_d, sve_st1##MEM##_host, sve_st1##MEM##_tlb);       \
 +{                                                                       \
 +    sve_st1_z(env, vd, vg, vm, base, desc, GETPC(), 0, 4, 1 << MSZ,     \
 +              off_##OFS##_s, sve_st1##MEM##_host, sve_st1##MEM##_tlb);  \
 +}                                                                       \
 +void HELPER(sve_st##MEM##_##OFS##_mte)(CPUARMState *env, void *vd, void *vg, \
 +    void *vm, target_ulong base, uint32_t desc)                         \
 +{                                                                       \
 +    sve_st1_z_mte(env, vd, vg, vm, base, desc, GETPC(), 4, 1 << MSZ,    \
 +                  off_##OFS##_s, sve_st1##MEM##_host, sve_st1##MEM##_tlb); \
 +}
 +
 +#define DO_ST1_ZPZ_D(MEM, OFS, MSZ)                                     \
 +void HELPER(sve_st##MEM##_##OFS)(CPUARMState *env, void *vd, void *vg,  \
 +                                 void *vm, target_ulong base, uint32_t desc) \
 +{                                                                       \
 +    sve_st1_z(env, vd, vg, vm, base, desc, GETPC(), 0, 8, 1 << MSZ,     \
 +              off_##OFS##_d, sve_st1##MEM##_host, sve_st1##MEM##_tlb);  \
 +}                                                                       \
 +void HELPER(sve_st##MEM##_##OFS##_mte)(CPUARMState *env, void *vd, void *vg, \
 +    void *vm, target_ulong base, uint32_t desc)                         \
 +{                                                                       \
 +    sve_st1_z_mte(env, vd, vg, vm, base, desc, GETPC(), 8, 1 << MSZ,    \
 +                  off_##OFS##_d, sve_st1##MEM##_host, sve_st1##MEM##_tlb); \
  }
  DO_ST1_ZPZ_S(bs, zsu, MO_8)
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-sve.c
 +++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_ST_zpri(DisasContext *s, arg_rpri_store *a)
   */
  static void do_mem_zpz(DisasContext *s, int zt, int pg, int zm,
 -                       int scale, TCGv_i64 scalar, int msz,
 +                       int scale, TCGv_i64 scalar, int msz, bool is_write,
                         gen_helper_gvec_mem_scatter *fn)
  {
      unsigned vsz = vec_full_reg_size(s);
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpz(DisasContext *s, int zt, int pg, int zm,
      TCGv_ptr t_pg = tcg_temp_new_ptr();
      TCGv_ptr t_zt = tcg_temp_new_ptr();
      TCGv_i32 t_desc;
 -    int desc;
 +    int desc = 0;
 +    if (s->mte_active[0]) {
 +        desc = FIELD_DP32(desc, MTEDESC, MIDX, get_mem_index(s));
 +        desc = FIELD_DP32(desc, MTEDESC, TBI, s->tbid);
 +        desc = FIELD_DP32(desc, MTEDESC, TCMA, s->tcma);
 +        desc = FIELD_DP32(desc, MTEDESC, WRITE, is_write);
 +        desc = FIELD_DP32(desc, MTEDESC, ESIZE, 1 << msz);
 +        desc <<= SVE_MTEDESC_SHIFT;
 +    }
      desc = simd_desc(vsz, vsz, scale);
      t_desc = tcg_const_i32(desc);
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpz(DisasContext *s, int zt, int pg, int zm,
      tcg_temp_free_i32(t_desc);
  }
 -/* Indexed by [be][ff][xs][u][msz].  */
 -static gen_helper_gvec_mem_scatter * const gather_load_fn32[2][2][2][2][3] = {
 -    /* Little-endian */
 -    { { { { gen_helper_sve_ldbss_zsu,
 -            gen_helper_sve_ldhss_le_zsu,
 -            NULL, },
 -          { gen_helper_sve_ldbsu_zsu,
 -            gen_helper_sve_ldhsu_le_zsu,
 -            gen_helper_sve_ldss_le_zsu, } },
 -        { { gen_helper_sve_ldbss_zss,
 -            gen_helper_sve_ldhss_le_zss,
 -            NULL, },
 -          { gen_helper_sve_ldbsu_zss,
 -            gen_helper_sve_ldhsu_le_zss,
 -            gen_helper_sve_ldss_le_zss, } } },
 +/* Indexed by [mte][be][ff][xs][u][msz].  */
 +static gen_helper_gvec_mem_scatter * const
 +gather_load_fn32[2][2][2][2][2][3] = {
 +    { /* MTE Inactive */
 +        { /* Little-endian */
 +            { { { gen_helper_sve_ldbss_zsu,
 +                  gen_helper_sve_ldhss_le_zsu,
 +                  NULL, },
 +                { gen_helper_sve_ldbsu_zsu,
 +                  gen_helper_sve_ldhsu_le_zsu,
 +                  gen_helper_sve_ldss_le_zsu, } },
 +              { { gen_helper_sve_ldbss_zss,
 +                  gen_helper_sve_ldhss_le_zss,
 +                  NULL, },
 +                { gen_helper_sve_ldbsu_zss,
 +                  gen_helper_sve_ldhsu_le_zss,
 +                  gen_helper_sve_ldss_le_zss, } } },
 -      /* First-fault */
 -      { { { gen_helper_sve_ldffbss_zsu,
 -            gen_helper_sve_ldffhss_le_zsu,
 -            NULL, },
 -          { gen_helper_sve_ldffbsu_zsu,
 -            gen_helper_sve_ldffhsu_le_zsu,
 -            gen_helper_sve_ldffss_le_zsu, } },
 -        { { gen_helper_sve_ldffbss_zss,
 -            gen_helper_sve_ldffhss_le_zss,
 -            NULL, },
 -          { gen_helper_sve_ldffbsu_zss,
 -            gen_helper_sve_ldffhsu_le_zss,
 -            gen_helper_sve_ldffss_le_zss, } } } },
 +            /* First-fault */
 +            { { { gen_helper_sve_ldffbss_zsu,
 +                  gen_helper_sve_ldffhss_le_zsu,
 +                  NULL, },
 +                { gen_helper_sve_ldffbsu_zsu,
 +                  gen_helper_sve_ldffhsu_le_zsu,
 +                  gen_helper_sve_ldffss_le_zsu, } },
 +              { { gen_helper_sve_ldffbss_zss,
 +                  gen_helper_sve_ldffhss_le_zss,
 +                  NULL, },
 +                { gen_helper_sve_ldffbsu_zss,
 +                  gen_helper_sve_ldffhsu_le_zss,
 +                  gen_helper_sve_ldffss_le_zss, } } } },
 -    /* Big-endian */
 -    { { { { gen_helper_sve_ldbss_zsu,
 -            gen_helper_sve_ldhss_be_zsu,
 -            NULL, },
 -          { gen_helper_sve_ldbsu_zsu,
 -            gen_helper_sve_ldhsu_be_zsu,
 -            gen_helper_sve_ldss_be_zsu, } },
 -        { { gen_helper_sve_ldbss_zss,
 -            gen_helper_sve_ldhss_be_zss,
 -            NULL, },
 -          { gen_helper_sve_ldbsu_zss,
 -            gen_helper_sve_ldhsu_be_zss,
 -            gen_helper_sve_ldss_be_zss, } } },
 +        { /* Big-endian */
 +            { { { gen_helper_sve_ldbss_zsu,
 +                  gen_helper_sve_ldhss_be_zsu,
 +                  NULL, },
 +                { gen_helper_sve_ldbsu_zsu,
 +                  gen_helper_sve_ldhsu_be_zsu,
 +                  gen_helper_sve_ldss_be_zsu, } },
 +              { { gen_helper_sve_ldbss_zss,
 +                  gen_helper_sve_ldhss_be_zss,
 +                  NULL, },
 +                { gen_helper_sve_ldbsu_zss,
 +                  gen_helper_sve_ldhsu_be_zss,
 +                  gen_helper_sve_ldss_be_zss, } } },
 -      /* First-fault */
 -      { { { gen_helper_sve_ldffbss_zsu,
 -            gen_helper_sve_ldffhss_be_zsu,
 -            NULL, },
 -          { gen_helper_sve_ldffbsu_zsu,
 -            gen_helper_sve_ldffhsu_be_zsu,
 -            gen_helper_sve_ldffss_be_zsu, } },
 -        { { gen_helper_sve_ldffbss_zss,
 -            gen_helper_sve_ldffhss_be_zss,
 -            NULL, },
 -          { gen_helper_sve_ldffbsu_zss,
 -            gen_helper_sve_ldffhsu_be_zss,
 -            gen_helper_sve_ldffss_be_zss, } } } },
 +            /* First-fault */
 +            { { { gen_helper_sve_ldffbss_zsu,
 +                  gen_helper_sve_ldffhss_be_zsu,
 +                  NULL, },
 +                { gen_helper_sve_ldffbsu_zsu,
 +                  gen_helper_sve_ldffhsu_be_zsu,
 +                  gen_helper_sve_ldffss_be_zsu, } },
 +              { { gen_helper_sve_ldffbss_zss,
 +                  gen_helper_sve_ldffhss_be_zss,
 +                  NULL, },
 +                { gen_helper_sve_ldffbsu_zss,
 +                  gen_helper_sve_ldffhsu_be_zss,
 +                  gen_helper_sve_ldffss_be_zss, } } } } },
 +    { /* MTE Active */
 +        { /* Little-endian */
 +            { { { gen_helper_sve_ldbss_zsu_mte,
 +                  gen_helper_sve_ldhss_le_zsu_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldbsu_zsu_mte,
 +                  gen_helper_sve_ldhsu_le_zsu_mte,
 +                  gen_helper_sve_ldss_le_zsu_mte, } },
 +              { { gen_helper_sve_ldbss_zss_mte,
 +                  gen_helper_sve_ldhss_le_zss_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldbsu_zss_mte,
 +                  gen_helper_sve_ldhsu_le_zss_mte,
 +                  gen_helper_sve_ldss_le_zss_mte, } } },
 +
 +            /* First-fault */
 +            { { { gen_helper_sve_ldffbss_zsu_mte,
 +                  gen_helper_sve_ldffhss_le_zsu_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldffbsu_zsu_mte,
 +                  gen_helper_sve_ldffhsu_le_zsu_mte,
 +                  gen_helper_sve_ldffss_le_zsu_mte, } },
 +              { { gen_helper_sve_ldffbss_zss_mte,
 +                  gen_helper_sve_ldffhss_le_zss_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldffbsu_zss_mte,
 +                  gen_helper_sve_ldffhsu_le_zss_mte,
 +                  gen_helper_sve_ldffss_le_zss_mte, } } } },
 +
 +        { /* Big-endian */
 +            { { { gen_helper_sve_ldbss_zsu_mte,
 +                  gen_helper_sve_ldhss_be_zsu_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldbsu_zsu_mte,
 +                  gen_helper_sve_ldhsu_be_zsu_mte,
 +                  gen_helper_sve_ldss_be_zsu_mte, } },
 +              { { gen_helper_sve_ldbss_zss_mte,
 +                  gen_helper_sve_ldhss_be_zss_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldbsu_zss_mte,
 +                  gen_helper_sve_ldhsu_be_zss_mte,
 +                  gen_helper_sve_ldss_be_zss_mte, } } },
 +
 +            /* First-fault */
 +            { { { gen_helper_sve_ldffbss_zsu_mte,
 +                  gen_helper_sve_ldffhss_be_zsu_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldffbsu_zsu_mte,
 +                  gen_helper_sve_ldffhsu_be_zsu_mte,
 +                  gen_helper_sve_ldffss_be_zsu_mte, } },
 +              { { gen_helper_sve_ldffbss_zss_mte,
 +                  gen_helper_sve_ldffhss_be_zss_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldffbsu_zss_mte,
 +                  gen_helper_sve_ldffhsu_be_zss_mte,
 +                  gen_helper_sve_ldffss_be_zss_mte, } } } } },
  };
  /* Note that we overload xs=2 to indicate 64-bit offset.  */
 -static gen_helper_gvec_mem_scatter * const gather_load_fn64[2][2][3][2][4] = {
 -    /* Little-endian */
 -    { { { { gen_helper_sve_ldbds_zsu,
 -            gen_helper_sve_ldhds_le_zsu,
 -            gen_helper_sve_ldsds_le_zsu,
 -            NULL, },
 -          { gen_helper_sve_ldbdu_zsu,
 -            gen_helper_sve_ldhdu_le_zsu,
 -            gen_helper_sve_ldsdu_le_zsu,
 -            gen_helper_sve_lddd_le_zsu, } },
 -        { { gen_helper_sve_ldbds_zss,
 -            gen_helper_sve_ldhds_le_zss,
 -            gen_helper_sve_ldsds_le_zss,
 -            NULL, },
 -          { gen_helper_sve_ldbdu_zss,
 -            gen_helper_sve_ldhdu_le_zss,
 -            gen_helper_sve_ldsdu_le_zss,
 -            gen_helper_sve_lddd_le_zss, } },
 -        { { gen_helper_sve_ldbds_zd,
 -            gen_helper_sve_ldhds_le_zd,
 -            gen_helper_sve_ldsds_le_zd,
 -            NULL, },
 -          { gen_helper_sve_ldbdu_zd,
 -            gen_helper_sve_ldhdu_le_zd,
 -            gen_helper_sve_ldsdu_le_zd,
 -            gen_helper_sve_lddd_le_zd, } } },
 +static gen_helper_gvec_mem_scatter * const
 +gather_load_fn64[2][2][2][3][2][4] = {
 +    { /* MTE Inactive */
 +        { /* Little-endian */
 +            { { { gen_helper_sve_ldbds_zsu,
 +                  gen_helper_sve_ldhds_le_zsu,
 +                  gen_helper_sve_ldsds_le_zsu,
 +                  NULL, },
 +                { gen_helper_sve_ldbdu_zsu,
 +                  gen_helper_sve_ldhdu_le_zsu,
 +                  gen_helper_sve_ldsdu_le_zsu,
 +                  gen_helper_sve_lddd_le_zsu, } },
 +              { { gen_helper_sve_ldbds_zss,
 +                  gen_helper_sve_ldhds_le_zss,
 +                  gen_helper_sve_ldsds_le_zss,
 +                  NULL, },
 +                { gen_helper_sve_ldbdu_zss,
 +                  gen_helper_sve_ldhdu_le_zss,
 +                  gen_helper_sve_ldsdu_le_zss,
 +                  gen_helper_sve_lddd_le_zss, } },
 +              { { gen_helper_sve_ldbds_zd,
 +                  gen_helper_sve_ldhds_le_zd,
 +                  gen_helper_sve_ldsds_le_zd,
 +                  NULL, },
 +                { gen_helper_sve_ldbdu_zd,
 +                  gen_helper_sve_ldhdu_le_zd,
 +                  gen_helper_sve_ldsdu_le_zd,
 +                  gen_helper_sve_lddd_le_zd, } } },
 -      /* First-fault */
 -      { { { gen_helper_sve_ldffbds_zsu,
 -            gen_helper_sve_ldffhds_le_zsu,
 -            gen_helper_sve_ldffsds_le_zsu,
 -            NULL, },
 -          { gen_helper_sve_ldffbdu_zsu,
 -            gen_helper_sve_ldffhdu_le_zsu,
 -            gen_helper_sve_ldffsdu_le_zsu,
 -            gen_helper_sve_ldffdd_le_zsu, } },
 -        { { gen_helper_sve_ldffbds_zss,
 -            gen_helper_sve_ldffhds_le_zss,
 -            gen_helper_sve_ldffsds_le_zss,
 -            NULL, },
 -          { gen_helper_sve_ldffbdu_zss,
 -            gen_helper_sve_ldffhdu_le_zss,
 -            gen_helper_sve_ldffsdu_le_zss,
 -            gen_helper_sve_ldffdd_le_zss, } },
 -        { { gen_helper_sve_ldffbds_zd,
 -            gen_helper_sve_ldffhds_le_zd,
 -            gen_helper_sve_ldffsds_le_zd,
 -            NULL, },
 -          { gen_helper_sve_ldffbdu_zd,
 -            gen_helper_sve_ldffhdu_le_zd,
 -            gen_helper_sve_ldffsdu_le_zd,
 -            gen_helper_sve_ldffdd_le_zd, } } } },
 +            /* First-fault */
 +            { { { gen_helper_sve_ldffbds_zsu,
 +                  gen_helper_sve_ldffhds_le_zsu,
 +                  gen_helper_sve_ldffsds_le_zsu,
 +                  NULL, },
 +                { gen_helper_sve_ldffbdu_zsu,
 +                  gen_helper_sve_ldffhdu_le_zsu,
 +                  gen_helper_sve_ldffsdu_le_zsu,
 +                  gen_helper_sve_ldffdd_le_zsu, } },
 +              { { gen_helper_sve_ldffbds_zss,
 +                  gen_helper_sve_ldffhds_le_zss,
 +                  gen_helper_sve_ldffsds_le_zss,
 +                  NULL, },
 +                { gen_helper_sve_ldffbdu_zss,
 +                  gen_helper_sve_ldffhdu_le_zss,
 +                  gen_helper_sve_ldffsdu_le_zss,
 +                  gen_helper_sve_ldffdd_le_zss, } },
 +              { { gen_helper_sve_ldffbds_zd,
 +                  gen_helper_sve_ldffhds_le_zd,
 +                  gen_helper_sve_ldffsds_le_zd,
 +                  NULL, },
 +                { gen_helper_sve_ldffbdu_zd,
 +                  gen_helper_sve_ldffhdu_le_zd,
 +                  gen_helper_sve_ldffsdu_le_zd,
 +                  gen_helper_sve_ldffdd_le_zd, } } } },
 +        { /* Big-endian */
 +            { { { gen_helper_sve_ldbds_zsu,
 +                  gen_helper_sve_ldhds_be_zsu,
 +                  gen_helper_sve_ldsds_be_zsu,
 +                  NULL, },
 +                { gen_helper_sve_ldbdu_zsu,
 +                  gen_helper_sve_ldhdu_be_zsu,
 +                  gen_helper_sve_ldsdu_be_zsu,
 +                  gen_helper_sve_lddd_be_zsu, } },
 +              { { gen_helper_sve_ldbds_zss,
 +                  gen_helper_sve_ldhds_be_zss,
 +                  gen_helper_sve_ldsds_be_zss,
 +                  NULL, },
 +                { gen_helper_sve_ldbdu_zss,
 +                  gen_helper_sve_ldhdu_be_zss,
 +                  gen_helper_sve_ldsdu_be_zss,
 +                  gen_helper_sve_lddd_be_zss, } },
 +              { { gen_helper_sve_ldbds_zd,
 +                  gen_helper_sve_ldhds_be_zd,
 +                  gen_helper_sve_ldsds_be_zd,
 +                  NULL, },
 +                { gen_helper_sve_ldbdu_zd,
 +                  gen_helper_sve_ldhdu_be_zd,
 +                  gen_helper_sve_ldsdu_be_zd,
 +                  gen_helper_sve_lddd_be_zd, } } },
 -    /* Big-endian */
 -    { { { { gen_helper_sve_ldbds_zsu,
 -            gen_helper_sve_ldhds_be_zsu,
 -            gen_helper_sve_ldsds_be_zsu,
 -            NULL, },
 -          { gen_helper_sve_ldbdu_zsu,
 -            gen_helper_sve_ldhdu_be_zsu,
 -            gen_helper_sve_ldsdu_be_zsu,
 -            gen_helper_sve_lddd_be_zsu, } },
 -        { { gen_helper_sve_ldbds_zss,
 -            gen_helper_sve_ldhds_be_zss,
 -            gen_helper_sve_ldsds_be_zss,
 -            NULL, },
 -          { gen_helper_sve_ldbdu_zss,
 -            gen_helper_sve_ldhdu_be_zss,
 -            gen_helper_sve_ldsdu_be_zss,
 -            gen_helper_sve_lddd_be_zss, } },
 -        { { gen_helper_sve_ldbds_zd,
 -            gen_helper_sve_ldhds_be_zd,
 -            gen_helper_sve_ldsds_be_zd,
 -            NULL, },
 -          { gen_helper_sve_ldbdu_zd,
 -            gen_helper_sve_ldhdu_be_zd,
 -            gen_helper_sve_ldsdu_be_zd,
 -            gen_helper_sve_lddd_be_zd, } } },
 +            /* First-fault */
 +            { { { gen_helper_sve_ldffbds_zsu,
 +                  gen_helper_sve_ldffhds_be_zsu,
 +                  gen_helper_sve_ldffsds_be_zsu,
 +                  NULL, },
 +                { gen_helper_sve_ldffbdu_zsu,
 +                  gen_helper_sve_ldffhdu_be_zsu,
 +                  gen_helper_sve_ldffsdu_be_zsu,
 +                  gen_helper_sve_ldffdd_be_zsu, } },
 +              { { gen_helper_sve_ldffbds_zss,
 +                  gen_helper_sve_ldffhds_be_zss,
 +                  gen_helper_sve_ldffsds_be_zss,
 +                  NULL, },
 +                { gen_helper_sve_ldffbdu_zss,
 +                  gen_helper_sve_ldffhdu_be_zss,
 +                  gen_helper_sve_ldffsdu_be_zss,
 +                  gen_helper_sve_ldffdd_be_zss, } },
 +              { { gen_helper_sve_ldffbds_zd,
 +                  gen_helper_sve_ldffhds_be_zd,
 +                  gen_helper_sve_ldffsds_be_zd,
 +                  NULL, },
 +                { gen_helper_sve_ldffbdu_zd,
 +                  gen_helper_sve_ldffhdu_be_zd,
 +                  gen_helper_sve_ldffsdu_be_zd,
 +                  gen_helper_sve_ldffdd_be_zd, } } } } },
 +    { /* MTE Active */
 +        { /* Little-endian */
 +            { { { gen_helper_sve_ldbds_zsu_mte,
 +                  gen_helper_sve_ldhds_le_zsu_mte,
 +                  gen_helper_sve_ldsds_le_zsu_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldbdu_zsu_mte,
 +                  gen_helper_sve_ldhdu_le_zsu_mte,
 +                  gen_helper_sve_ldsdu_le_zsu_mte,
 +                  gen_helper_sve_lddd_le_zsu_mte, } },
 +              { { gen_helper_sve_ldbds_zss_mte,
 +                  gen_helper_sve_ldhds_le_zss_mte,
 +                  gen_helper_sve_ldsds_le_zss_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldbdu_zss_mte,
 +                  gen_helper_sve_ldhdu_le_zss_mte,
 +                  gen_helper_sve_ldsdu_le_zss_mte,
 +                  gen_helper_sve_lddd_le_zss_mte, } },
 +              { { gen_helper_sve_ldbds_zd_mte,
 +                  gen_helper_sve_ldhds_le_zd_mte,
 +                  gen_helper_sve_ldsds_le_zd_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldbdu_zd_mte,
 +                  gen_helper_sve_ldhdu_le_zd_mte,
 +                  gen_helper_sve_ldsdu_le_zd_mte,
 +                  gen_helper_sve_lddd_le_zd_mte, } } },
 -      /* First-fault */
 -      { { { gen_helper_sve_ldffbds_zsu,
 -            gen_helper_sve_ldffhds_be_zsu,
 -            gen_helper_sve_ldffsds_be_zsu,
 -            NULL, },
 -          { gen_helper_sve_ldffbdu_zsu,
 -            gen_helper_sve_ldffhdu_be_zsu,
 -            gen_helper_sve_ldffsdu_be_zsu,
 -            gen_helper_sve_ldffdd_be_zsu, } },
 -        { { gen_helper_sve_ldffbds_zss,
 -            gen_helper_sve_ldffhds_be_zss,
 -            gen_helper_sve_ldffsds_be_zss,
 -            NULL, },
 -          { gen_helper_sve_ldffbdu_zss,
 -            gen_helper_sve_ldffhdu_be_zss,
 -            gen_helper_sve_ldffsdu_be_zss,
 -            gen_helper_sve_ldffdd_be_zss, } },
 -        { { gen_helper_sve_ldffbds_zd,
 -            gen_helper_sve_ldffhds_be_zd,
 -            gen_helper_sve_ldffsds_be_zd,
 -            NULL, },
 -          { gen_helper_sve_ldffbdu_zd,
 -            gen_helper_sve_ldffhdu_be_zd,
 -            gen_helper_sve_ldffsdu_be_zd,
 -            gen_helper_sve_ldffdd_be_zd, } } } },
 +            /* First-fault */
 +            { { { gen_helper_sve_ldffbds_zsu_mte,
 +                  gen_helper_sve_ldffhds_le_zsu_mte,
 +                  gen_helper_sve_ldffsds_le_zsu_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldffbdu_zsu_mte,
 +                  gen_helper_sve_ldffhdu_le_zsu_mte,
 +                  gen_helper_sve_ldffsdu_le_zsu_mte,
 +                  gen_helper_sve_ldffdd_le_zsu_mte, } },
 +              { { gen_helper_sve_ldffbds_zss_mte,
 +                  gen_helper_sve_ldffhds_le_zss_mte,
 +                  gen_helper_sve_ldffsds_le_zss_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldffbdu_zss_mte,
 +                  gen_helper_sve_ldffhdu_le_zss_mte,
 +                  gen_helper_sve_ldffsdu_le_zss_mte,
 +                  gen_helper_sve_ldffdd_le_zss_mte, } },
 +              { { gen_helper_sve_ldffbds_zd_mte,
 +                  gen_helper_sve_ldffhds_le_zd_mte,
 +                  gen_helper_sve_ldffsds_le_zd_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldffbdu_zd_mte,
 +                  gen_helper_sve_ldffhdu_le_zd_mte,
 +                  gen_helper_sve_ldffsdu_le_zd_mte,
 +                  gen_helper_sve_ldffdd_le_zd_mte, } } } },
 +        { /* Big-endian */
 +            { { { gen_helper_sve_ldbds_zsu_mte,
 +                  gen_helper_sve_ldhds_be_zsu_mte,
 +                  gen_helper_sve_ldsds_be_zsu_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldbdu_zsu_mte,
 +                  gen_helper_sve_ldhdu_be_zsu_mte,
 +                  gen_helper_sve_ldsdu_be_zsu_mte,
 +                  gen_helper_sve_lddd_be_zsu_mte, } },
 +              { { gen_helper_sve_ldbds_zss_mte,
 +                  gen_helper_sve_ldhds_be_zss_mte,
 +                  gen_helper_sve_ldsds_be_zss_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldbdu_zss_mte,
 +                  gen_helper_sve_ldhdu_be_zss_mte,
 +                  gen_helper_sve_ldsdu_be_zss_mte,
 +                  gen_helper_sve_lddd_be_zss_mte, } },
 +              { { gen_helper_sve_ldbds_zd_mte,
 +                  gen_helper_sve_ldhds_be_zd_mte,
 +                  gen_helper_sve_ldsds_be_zd_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldbdu_zd_mte,
 +                  gen_helper_sve_ldhdu_be_zd_mte,
 +                  gen_helper_sve_ldsdu_be_zd_mte,
 +                  gen_helper_sve_lddd_be_zd_mte, } } },
 +
 +            /* First-fault */
 +            { { { gen_helper_sve_ldffbds_zsu_mte,
 +                  gen_helper_sve_ldffhds_be_zsu_mte,
 +                  gen_helper_sve_ldffsds_be_zsu_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldffbdu_zsu_mte,
 +                  gen_helper_sve_ldffhdu_be_zsu_mte,
 +                  gen_helper_sve_ldffsdu_be_zsu_mte,
 +                  gen_helper_sve_ldffdd_be_zsu_mte, } },
 +              { { gen_helper_sve_ldffbds_zss_mte,
 +                  gen_helper_sve_ldffhds_be_zss_mte,
 +                  gen_helper_sve_ldffsds_be_zss_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldffbdu_zss_mte,
 +                  gen_helper_sve_ldffhdu_be_zss_mte,
 +                  gen_helper_sve_ldffsdu_be_zss_mte,
 +                  gen_helper_sve_ldffdd_be_zss_mte, } },
 +              { { gen_helper_sve_ldffbds_zd_mte,
 +                  gen_helper_sve_ldffhds_be_zd_mte,
 +                  gen_helper_sve_ldffsds_be_zd_mte,
 +                  NULL, },
 +                { gen_helper_sve_ldffbdu_zd_mte,
 +                  gen_helper_sve_ldffhdu_be_zd_mte,
 +                  gen_helper_sve_ldffsdu_be_zd_mte,
 +                  gen_helper_sve_ldffdd_be_zd_mte, } } } } },
  };
  static bool trans_LD1_zprz(DisasContext *s, arg_LD1_zprz *a)
  {
      gen_helper_gvec_mem_scatter *fn = NULL;
 -    int be = s->be_data == MO_BE;
 +    bool be = s->be_data == MO_BE;
 +    bool mte = s->mte_active[0];
      if (!sve_access_check(s)) {
          return true;
@@ -XXX,XX +XXX,XX @@ static bool trans_LD1_zprz(DisasContext *s, arg_LD1_zprz *a)
      switch (a->esz) {
      case MO_32:
 -        fn = gather_load_fn32[be][a->ff][a->xs][a->u][a->msz];
 +        fn = gather_load_fn32[mte][be][a->ff][a->xs][a->u][a->msz];
          break;
      case MO_64:
 -        fn = gather_load_fn64[be][a->ff][a->xs][a->u][a->msz];
 +        fn = gather_load_fn64[mte][be][a->ff][a->xs][a->u][a->msz];
          break;
      }
      assert(fn != NULL);
      do_mem_zpz(s, a->rd, a->pg, a->rm, a->scale * a->msz,
 -               cpu_reg_sp(s, a->rn), a->msz, fn);
 +               cpu_reg_sp(s, a->rn), a->msz, false, fn);
      return true;
  }
  static bool trans_LD1_zpiz(DisasContext *s, arg_LD1_zpiz *a)
  {
      gen_helper_gvec_mem_scatter *fn = NULL;
 -    int be = s->be_data == MO_BE;
 +    bool be = s->be_data == MO_BE;
 +    bool mte = s->mte_active[0];
      TCGv_i64 imm;
      if (a->esz < a->msz || (a->esz == a->msz && !a->u)) {
@@ -XXX,XX +XXX,XX @@ static bool trans_LD1_zpiz(DisasContext *s, arg_LD1_zpiz *a)
      switch (a->esz) {
      case MO_32:
 -        fn = gather_load_fn32[be][a->ff][0][a->u][a->msz];
 +        fn = gather_load_fn32[mte][be][a->ff][0][a->u][a->msz];
          break;
      case MO_64:
 -        fn = gather_load_fn64[be][a->ff][2][a->u][a->msz];
 +        fn = gather_load_fn64[mte][be][a->ff][2][a->u][a->msz];
          break;
      }
      assert(fn != NULL);
@@ -XXX,XX +XXX,XX @@ static bool trans_LD1_zpiz(DisasContext *s, arg_LD1_zpiz *a)
       * by loading the immediate into the scalar parameter.
       */
      imm = tcg_const_i64(a->imm << a->msz);
 -    do_mem_zpz(s, a->rd, a->pg, a->rn, 0, imm, a->msz, fn);
 +    do_mem_zpz(s, a->rd, a->pg, a->rn, 0, imm, a->msz, false, fn);
      tcg_temp_free_i64(imm);
      return true;
  }
 -/* Indexed by [be][xs][msz].  */
 -static gen_helper_gvec_mem_scatter * const scatter_store_fn32[2][2][3] = {
 -    /* Little-endian */
 -    { { gen_helper_sve_stbs_zsu,
 -        gen_helper_sve_sths_le_zsu,
 -        gen_helper_sve_stss_le_zsu, },
 -      { gen_helper_sve_stbs_zss,
 -        gen_helper_sve_sths_le_zss,
 -        gen_helper_sve_stss_le_zss, } },
 -    /* Big-endian */
 -    { { gen_helper_sve_stbs_zsu,
 -        gen_helper_sve_sths_be_zsu,
 -        gen_helper_sve_stss_be_zsu, },
 -      { gen_helper_sve_stbs_zss,
 -        gen_helper_sve_sths_be_zss,
 -        gen_helper_sve_stss_be_zss, } },
 +/* Indexed by [mte][be][xs][msz].  */
 +static gen_helper_gvec_mem_scatter * const scatter_store_fn32[2][2][2][3] = {
 +    { /* MTE Inactive */
 +        { /* Little-endian */
 +            { gen_helper_sve_stbs_zsu,
 +              gen_helper_sve_sths_le_zsu,
 +              gen_helper_sve_stss_le_zsu, },
 +            { gen_helper_sve_stbs_zss,
 +              gen_helper_sve_sths_le_zss,
 +              gen_helper_sve_stss_le_zss, } },
 +        { /* Big-endian */
 +            { gen_helper_sve_stbs_zsu,
 +              gen_helper_sve_sths_be_zsu,
 +              gen_helper_sve_stss_be_zsu, },
 +            { gen_helper_sve_stbs_zss,
 +              gen_helper_sve_sths_be_zss,
 +              gen_helper_sve_stss_be_zss, } } },
 +    { /* MTE Active */
 +        { /* Little-endian */
 +            { gen_helper_sve_stbs_zsu_mte,
 +              gen_helper_sve_sths_le_zsu_mte,
 +              gen_helper_sve_stss_le_zsu_mte, },
 +            { gen_helper_sve_stbs_zss_mte,
 +              gen_helper_sve_sths_le_zss_mte,
 +              gen_helper_sve_stss_le_zss_mte, } },
 +        { /* Big-endian */
 +            { gen_helper_sve_stbs_zsu_mte,
 +              gen_helper_sve_sths_be_zsu_mte,
 +              gen_helper_sve_stss_be_zsu_mte, },
 +            { gen_helper_sve_stbs_zss_mte,
 +              gen_helper_sve_sths_be_zss_mte,
 +              gen_helper_sve_stss_be_zss_mte, } } },
  };
  /* Note that we overload xs=2 to indicate 64-bit offset.  */
 -static gen_helper_gvec_mem_scatter * const scatter_store_fn64[2][3][4] = {
 -    /* Little-endian */
 -    { { gen_helper_sve_stbd_zsu,
 -        gen_helper_sve_sthd_le_zsu,
 -        gen_helper_sve_stsd_le_zsu,
 -        gen_helper_sve_stdd_le_zsu, },
 -      { gen_helper_sve_stbd_zss,
 -        gen_helper_sve_sthd_le_zss,
 -        gen_helper_sve_stsd_le_zss,
 -        gen_helper_sve_stdd_le_zss, },
 -      { gen_helper_sve_stbd_zd,
 -        gen_helper_sve_sthd_le_zd,
 -        gen_helper_sve_stsd_le_zd,
 -        gen_helper_sve_stdd_le_zd, } },
 -    /* Big-endian */
 -    { { gen_helper_sve_stbd_zsu,
 -        gen_helper_sve_sthd_be_zsu,
 -        gen_helper_sve_stsd_be_zsu,
 -        gen_helper_sve_stdd_be_zsu, },
 -      { gen_helper_sve_stbd_zss,
 -        gen_helper_sve_sthd_be_zss,
 -        gen_helper_sve_stsd_be_zss,
 -        gen_helper_sve_stdd_be_zss, },
 -      { gen_helper_sve_stbd_zd,
 -        gen_helper_sve_sthd_be_zd,
 -        gen_helper_sve_stsd_be_zd,
 -        gen_helper_sve_stdd_be_zd, } },
 +static gen_helper_gvec_mem_scatter * const scatter_store_fn64[2][2][3][4] = {
 +    { /* MTE Inactive */
 +         { /* Little-endian */
 +             { gen_helper_sve_stbd_zsu,
 +               gen_helper_sve_sthd_le_zsu,
 +               gen_helper_sve_stsd_le_zsu,
 +               gen_helper_sve_stdd_le_zsu, },
 +             { gen_helper_sve_stbd_zss,
 +               gen_helper_sve_sthd_le_zss,
 +               gen_helper_sve_stsd_le_zss,
 +               gen_helper_sve_stdd_le_zss, },
 +             { gen_helper_sve_stbd_zd,
 +               gen_helper_sve_sthd_le_zd,
 +               gen_helper_sve_stsd_le_zd,
 +               gen_helper_sve_stdd_le_zd, } },
 +         { /* Big-endian */
 +             { gen_helper_sve_stbd_zsu,
 +               gen_helper_sve_sthd_be_zsu,
 +               gen_helper_sve_stsd_be_zsu,
 +               gen_helper_sve_stdd_be_zsu, },
 +             { gen_helper_sve_stbd_zss,
 +               gen_helper_sve_sthd_be_zss,
 +               gen_helper_sve_stsd_be_zss,
 +               gen_helper_sve_stdd_be_zss, },
 +             { gen_helper_sve_stbd_zd,
 +               gen_helper_sve_sthd_be_zd,
 +               gen_helper_sve_stsd_be_zd,
 +               gen_helper_sve_stdd_be_zd, } } },
 +    { /* MTE Inactive */
 +         { /* Little-endian */
 +             { gen_helper_sve_stbd_zsu_mte,
 +               gen_helper_sve_sthd_le_zsu_mte,
 +               gen_helper_sve_stsd_le_zsu_mte,
 +               gen_helper_sve_stdd_le_zsu_mte, },
 +             { gen_helper_sve_stbd_zss_mte,
 +               gen_helper_sve_sthd_le_zss_mte,
 +               gen_helper_sve_stsd_le_zss_mte,
 +               gen_helper_sve_stdd_le_zss_mte, },
 +             { gen_helper_sve_stbd_zd_mte,
 +               gen_helper_sve_sthd_le_zd_mte,
 +               gen_helper_sve_stsd_le_zd_mte,
 +               gen_helper_sve_stdd_le_zd_mte, } },
 +         { /* Big-endian */
 +             { gen_helper_sve_stbd_zsu_mte,
 +               gen_helper_sve_sthd_be_zsu_mte,
 +               gen_helper_sve_stsd_be_zsu_mte,
 +               gen_helper_sve_stdd_be_zsu_mte, },
 +             { gen_helper_sve_stbd_zss_mte,
 +               gen_helper_sve_sthd_be_zss_mte,
 +               gen_helper_sve_stsd_be_zss_mte,
 +               gen_helper_sve_stdd_be_zss_mte, },
 +             { gen_helper_sve_stbd_zd_mte,
 +               gen_helper_sve_sthd_be_zd_mte,
 +               gen_helper_sve_stsd_be_zd_mte,
 +               gen_helper_sve_stdd_be_zd_mte, } } },
  };
  static bool trans_ST1_zprz(DisasContext *s, arg_ST1_zprz *a)
  {
      gen_helper_gvec_mem_scatter *fn;
 -    int be = s->be_data == MO_BE;
 +    bool be = s->be_data == MO_BE;
 +    bool mte = s->mte_active[0];
      if (a->esz < a->msz || (a->msz == 0 && a->scale)) {
          return false;
@@ -XXX,XX +XXX,XX @@ static bool trans_ST1_zprz(DisasContext *s, arg_ST1_zprz *a)
      }
      switch (a->esz) {
      case MO_32:
 -        fn = scatter_store_fn32[be][a->xs][a->msz];
 +        fn = scatter_store_fn32[mte][be][a->xs][a->msz];
          break;
      case MO_64:
 -        fn = scatter_store_fn64[be][a->xs][a->msz];
 +        fn = scatter_store_fn64[mte][be][a->xs][a->msz];
          break;
      default:
          g_assert_not_reached();
      }
-     do_mem_zpz(s, a->rd, a->pg, a->rm, a->scale * a->msz,
--               cpu_reg_sp(s, a->rn), a->msz, fn);
+-    if (which) {
-+               cpu_reg_sp(s, a->rn), a->msz, true, fn);
+-        a = b;
-     return true;
++    if (is_snan(ret->cls)) {
 +        parts_silence_nan(ret, s);
      }
 -    if (is_snan(a->cls)) {
 -        parts_silence_nan(a, s);
 -    }
 -    return a;
 +    return ret;
  }
- static bool trans_ST1_zpiz(DisasContext *s, arg_ST1_zpiz *a)
+ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
  {
      gen_helper_gvec_mem_scatter *fn = NULL;
 -    int be = s->be_data == MO_BE;
 +    bool be = s->be_data == MO_BE;
 +    bool mte = s->mte_active[0];
      TCGv_i64 imm;
      if (a->esz < a->msz) {
@@ -XXX,XX +XXX,XX @@ static bool trans_ST1_zpiz(DisasContext *s, arg_ST1_zpiz *a)
      switch (a->esz) {
      case MO_32:
 -        fn = scatter_store_fn32[be][0][a->msz];
 +        fn = scatter_store_fn32[mte][be][0][a->msz];
          break;
      case MO_64:
 -        fn = scatter_store_fn64[be][2][a->msz];
 +        fn = scatter_store_fn64[mte][be][2][a->msz];
          break;
      }
      assert(fn != NULL);
@@ -XXX,XX +XXX,XX @@ static bool trans_ST1_zpiz(DisasContext *s, arg_ST1_zpiz *a)
       * by loading the immediate into the scalar parameter.
       */
      imm = tcg_const_i64(a->imm << a->msz);
 -    do_mem_zpz(s, a->rd, a->pg, a->rn, 0, imm, a->msz, fn);
 +    do_mem_zpz(s, a->rd, a->pg, a->rn, 0, imm, a->msz, true, fn);
      tcg_temp_free_i64(imm);
      return true;
  }
 --
-.20.1
+.34.1

-[PULL 18/57] target/arm: Add DISAS_UPDATE_NOCHAIN
+[PULL 71/72] MAINTAINERS: update email address for Leif Lindholm
-From: Richard Henderson <richard.henderson@linaro.org>
+From: Leif Lindholm <quic_llindhol@quicinc.com>
-Add an option that writes back the PC, like DISAS_UPDATE_EXIT,
+I'm migrating to Qualcomm's new open source email infrastructure, so
-but does not exit back to the main loop.
+update my email address, and update the mailmap to match.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Signed-off-by: Leif Lindholm <leif.lindholm@oss.qualcomm.com>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Leif Lindholm <quic_llindhol@quicinc.com>
-Message-id: 20200626033144.790098-7-richard.henderson@linaro.org
+Reviewed-by: Brian Cain <brian.cain@oss.qualcomm.com>
 Reviewed-by: Philippe Mathieu-Daudé <philmd@linaro.org>
 Tested-by: Philippe Mathieu-Daudé <philmd@linaro.org>
 Message-id: 20241205114047.1125842-1-leif.lindholm@oss.qualcomm.com
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate.h     | 2 ++
+ MAINTAINERS | 2 +-
- target/arm/translate-a64.c | 3 +++
+ .mailmap    | 5 +++--
- target/arm/translate.c     | 4 ++++
+files changed, 4 insertions(+), 3 deletions(-)
 files changed, 9 insertions(+)
-diff --git a/target/arm/translate.h b/target/arm/translate.h
+diff --git a/MAINTAINERS b/MAINTAINERS
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate.h
+--- a/MAINTAINERS
-+++ b/target/arm/translate.h
++++ b/MAINTAINERS
-@@ -XXX,XX +XXX,XX @@ static inline void disas_set_insn_syndrome(DisasContext *s, uint32_t syn)
+@@ -XXX,XX +XXX,XX @@ F: include/hw/ssi/imx_spi.h
-  * return from cpu_tb_exec.
+ SBSA-REF
-  */
+ M: Radoslaw Biernacki <rad@semihalf.com>
- #define DISAS_EXIT      DISAS_TARGET_9
+ M: Peter Maydell <peter.maydell@linaro.org>
-+/* CPU state was modified dynamically; no need to exit, but do not chain. */
+-R: Leif Lindholm <quic_llindhol@quicinc.com>
-+#define DISAS_UPDATE_NOCHAIN  DISAS_TARGET_10
++R: Leif Lindholm <leif.lindholm@oss.qualcomm.com>
+ R: Marcin Juszkiewicz <marcin.juszkiewicz@linaro.org>
- #ifdef TARGET_AARCH64
+ L: qemu-arm@nongnu.org
- void a64_translate_init(void);
+ S: Maintained
-diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
+diff --git a/.mailmap b/.mailmap
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-a64.c
+--- a/.mailmap
-+++ b/target/arm/translate-a64.c
++++ b/.mailmap
-@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_tb_stop(DisasContextBase *dcbase, CPUState *cpu)
+@@ -XXX,XX +XXX,XX @@ Huacai Chen <chenhuacai@kernel.org> <chenhc@lemote.com>
-         case DISAS_EXIT:
+ Huacai Chen <chenhuacai@kernel.org> <chenhuacai@loongson.cn>
-             tcg_gen_exit_tb(NULL, 0);
+ James Hogan <jhogan@kernel.org> <james.hogan@imgtec.com>
-             break;
+ Juan Quintela <quintela@trasno.org> <quintela@redhat.com>
-+        case DISAS_UPDATE_NOCHAIN:
+-Leif Lindholm <quic_llindhol@quicinc.com> <leif.lindholm@linaro.org>
-+            gen_a64_set_pc_im(dc->base.pc_next);
+-Leif Lindholm <quic_llindhol@quicinc.com> <leif@nuviainc.com>
-+            /* fall through */
++Leif Lindholm <leif.lindholm@oss.qualcomm.com> <quic_llindhol@quicinc.com>
-         case DISAS_JUMP:
++Leif Lindholm <leif.lindholm@oss.qualcomm.com> <leif.lindholm@linaro.org>
-             tcg_gen_lookup_and_goto_ptr();
++Leif Lindholm <leif.lindholm@oss.qualcomm.com> <leif@nuviainc.com>
-             break;
+ Luc Michel <luc@lmichel.fr> <luc.michel@git.antfield.fr>
-diff --git a/target/arm/translate.c b/target/arm/translate.c
+ Luc Michel <luc@lmichel.fr> <luc.michel@greensocs.com>
-index XXXXXXX..XXXXXXX 100644
+ Luc Michel <luc@lmichel.fr> <lmichel@kalray.eu>
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void arm_tr_tb_stop(DisasContextBase *dcbase, CPUState *cpu)
          case DISAS_NEXT:
          case DISAS_TOO_MANY:
          case DISAS_UPDATE_EXIT:
 +        case DISAS_UPDATE_NOCHAIN:
              gen_set_pc_im(dc, dc->base.pc_next);
              /* fall through */
          default:
@@ -XXX,XX +XXX,XX @@ static void arm_tr_tb_stop(DisasContextBase *dcbase, CPUState *cpu)
          case DISAS_TOO_MANY:
              gen_goto_tb(dc, 1, dc->base.pc_next);
              break;
 +        case DISAS_UPDATE_NOCHAIN:
 +            gen_set_pc_im(dc, dc->base.pc_next);
 +            /* fall through */
          case DISAS_JUMP:
              gen_goto_ptr();
              break;
 --
-.20.1
+.34.1

-[PULL 01/57] hw/arm/aspeed: Remove extraneous MemoryRegion object owner
+[PULL 72/72] MAINTAINERS: Add correct email address for Vikram Garhwal
-From: Philippe Mathieu-Daudé <f4bug@amsat.org>
+From: Vikram Garhwal <vikram.garhwal@bytedance.com>
-I'm confused by this code, 'bmc' is created as:
+Previously, maintainer role was paused due to inactive email id. Commit id:
 c009d715721861984c4987bcc78b7ee183e86d75.
-  bmc = g_new0(AspeedBoardState, 1);
+Signed-off-by: Vikram Garhwal <vikram.garhwal@bytedance.com>
+Reviewed-by: Francisco Iglesias <francisco.iglesias@amd.com>
-Then we use it as QOM owner for different MemoryRegion objects.
+Message-id: 20241204184205.12952-1-vikram.garhwal@bytedance.com
 But looking at memory_region_init_ram (similarly for ROM):
   void memory_region_init_ram(MemoryRegion *mr,
                               struct Object *owner,
                               const char *name,
                               uint64_t size,
                               Error **errp)
   {
       DeviceState *owner_dev;
       Error *err = NULL;
       memory_region_init_ram_nomigrate(mr, owner, name, size, &err);
       if (err) {
           error_propagate(errp, err);
           return;
       }
       /* This will assert if owner is neither NULL nor a DeviceState.
        * We only want the owner here for the purposes of defining a
        * unique name for migration. TODO: Ideally we should implement
        * a naming scheme for Objects which are not DeviceStates, in
        * which case we can relax this restriction.
        */
       owner_dev = DEVICE(owner);
       vmstate_register_ram(mr, owner_dev);
   }
 The expected assertion is not triggered ('bmc' is not NULL neither
 a DeviceState).
 'bmc' structure is defined as:
   struct AspeedBoardState {
       AspeedSoCState soc;
       MemoryRegion ram_container;
       MemoryRegion max_ram;
   };
 What happens is when using 'OBJECT(bmc)', the QOM macros cast the
 memory pointed by bmc, which first member is 'soc', which is
 initialized ...:
   object_initialize_child(OBJECT(machine), "soc",
                           &bmc->soc, amc->soc_name);
 The 'soc' object is indeed a DeviceState, so the assertion passes.
 Since this is fragile and only happens to work by luck, remove the
 dangerous OBJECT(bmc) owner argument.
 Note, this probably breaks migration for this machine.
 Reviewed-by: Cédric Le Goater <clg@kaod.org>
 Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
 Message-id: 20200623072132.2868-2-f4bug@amsat.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- hw/arm/aspeed.c | 6 +++---
+ MAINTAINERS | 2 ++
-file changed, 3 insertions(+), 3 deletions(-)
+file changed, 2 insertions(+)
-diff --git a/hw/arm/aspeed.c b/hw/arm/aspeed.c
+diff --git a/MAINTAINERS b/MAINTAINERS
 index XXXXXXX..XXXXXXX 100644
---- a/hw/arm/aspeed.c
+--- a/MAINTAINERS
-+++ b/hw/arm/aspeed.c
++++ b/MAINTAINERS
-@@ -XXX,XX +XXX,XX @@ static void aspeed_machine_init(MachineState *machine)
+@@ -XXX,XX +XXX,XX @@ F: tests/qtest/fuzz-sb16-test.c
-          * needed by the flash modules of the Aspeed machines.
-          */
+ Xilinx CAN
-         if (ASPEED_MACHINE(machine)->mmio_exec) {
+ M: Francisco Iglesias <francisco.iglesias@amd.com>
--            memory_region_init_alias(boot_rom, OBJECT(bmc), "aspeed.boot_rom",
++M: Vikram Garhwal <vikram.garhwal@bytedance.com>
-+            memory_region_init_alias(boot_rom, NULL, "aspeed.boot_rom",
+ S: Maintained
-                                      &fl->mmio, 0, fl->size);
+ F: hw/net/can/xlnx-*
-             memory_region_add_subregion(get_system_memory(), FIRMWARE_ADDR,
+ F: include/hw/net/xlnx-*
-                                         boot_rom);
+@@ -XXX,XX +XXX,XX @@ F: include/hw/rx/
-         } else {
+ CAN bus subsystem and hardware
--            memory_region_init_rom(boot_rom, OBJECT(bmc), "aspeed.boot_rom",
+ M: Pavel Pisa <pisa@cmp.felk.cvut.cz>
-+            memory_region_init_rom(boot_rom, NULL, "aspeed.boot_rom",
+ M: Francisco Iglesias <francisco.iglesias@amd.com>
-                                    fl->size, &error_abort);
++M: Vikram Garhwal <vikram.garhwal@bytedance.com>
-             memory_region_add_subregion(get_system_memory(), FIRMWARE_ADDR,
+ S: Maintained
-                                         boot_rom);
+ W: https://canbus.pages.fel.cvut.cz/
-@@ -XXX,XX +XXX,XX @@ static void aspeed_machine_init(MachineState *machine)
+ F: net/can/*
      if (machine->kernel_filename && sc->num_cpus > 1) {
          /* With no u-boot we must set up a boot stub for the secondary CPU */
          MemoryRegion *smpboot = g_new(MemoryRegion, 1);
 -        memory_region_init_ram(smpboot, OBJECT(bmc), "aspeed.smpboot",
 +        memory_region_init_ram(smpboot, NULL, "aspeed.smpboot",
 x80, &error_abort);
          memory_region_add_subregion(get_system_memory(),
                                      AST_SMP_MAILBOX_BASE, smpboot);
 --
-.20.1
+.34.1

Mostly this is RTH's memtag series, but there are also some cleanups
from Philippe.

thanks
-- PMM

The following changes since commit 10f7ffabf9c507fc02382b89912003b1c43c3231:

Merge remote-tracking branch 'remotes/mcayland/tags/qemu-macppc-20200626' into staging (2020-06-26 12:14:18 +0100)

are available in the Git repository at:

https://git.linaro.org/people/pmaydell/qemu-arm.git tags/pull-target-arm-20200626

for you to fetch changes up to c7459633baa71d1781fde4a245d6ec9ce2f008cf:

target/arm: Enable MTE (2020-06-26 14:32:24 +0100)

----------------------------------------------------------------
target-arm queue:
 * hw/arm/aspeed: improve QOM usage
 * hw/misc/pca9552: trace GPIO change events
 * target/arm: Implement ARMv8.5-MemTag for system emulation

----------------------------------------------------------------
Philippe Mathieu-Daudé (12):
      hw/arm/aspeed: Remove extraneous MemoryRegion object owner
      hw/arm/aspeed: Rename AspeedBoardState as AspeedMachineState
      hw/arm/aspeed: QOM'ify AspeedMachineState
      hw/i2c/core: Add i2c_try_create_slave() and i2c_realize_and_unref()
      hw/misc/pca9552: Rename 'nr_leds' as 'pin_count'
      hw/misc/pca9552: Rename generic code as pca955x
      hw/misc/pca9552: Add generic PCA955xClass, parent of TYPE_PCA9552
      hw/misc/pca9552: Add a 'description' property for debugging purpose
      hw/misc/pca9552: Trace GPIO High/Low events
      hw/arm/aspeed: Describe each PCA9552 device
      hw/misc/pca9552: Trace GPIO change events
      hw/misc/pca9552: Model qdev output GPIOs

Richard Henderson (45):
      target/arm: Add isar tests for mte
      target/arm: Improve masking of SCR RES0 bits
      target/arm: Add support for MTE to SCTLR_ELx
      target/arm: Add support for MTE to HCR_EL2 and SCR_EL3
      target/arm: Rename DISAS_UPDATE to DISAS_UPDATE_EXIT
      target/arm: Add DISAS_UPDATE_NOCHAIN
      target/arm: Add MTE system registers
      target/arm: Add MTE bits to tb_flags
      target/arm: Implement the IRG instruction
      target/arm: Revise decoding for disas_add_sub_imm
      target/arm: Implement the ADDG, SUBG instructions
      target/arm: Implement the GMI instruction
      target/arm: Implement the SUBP instruction
      target/arm: Define arm_cpu_do_unaligned_access for user-only
      target/arm: Implement LDG, STG, ST2G instructions
      target/arm: Implement the STGP instruction
      target/arm: Restrict the values of DCZID.BS under TCG
      target/arm: Simplify DC_ZVA
      target/arm: Implement the LDGM, STGM, STZGM instructions
      target/arm: Implement the access tag cache flushes
      target/arm: Move regime_el to internals.h
      target/arm: Move regime_tcr to internals.h
      target/arm: Add gen_mte_check1
      target/arm: Add gen_mte_checkN
      target/arm: Implement helper_mte_check1
      target/arm: Implement helper_mte_checkN
      target/arm: Add helper_mte_check_zva
      target/arm: Use mte_checkN for sve unpredicated loads
      target/arm: Use mte_checkN for sve unpredicated stores
      target/arm: Use mte_check1 for sve LD1R
      target/arm: Tidy trans_LD1R_zpri
      target/arm: Add arm_tlb_bti_gp
      target/arm: Add mte helpers for sve scalar + int loads
      target/arm: Add mte helpers for sve scalar + int stores
      target/arm: Add mte helpers for sve scalar + int ff/nf loads
      target/arm: Handle TBI for sve scalar + int memory ops
      target/arm: Add mte helpers for sve scatter/gather memory ops
      target/arm: Complete TBI clearing for user-only for SVE
      target/arm: Implement data cache set allocation tags
      target/arm: Set PSTATE.TCO on exception entry
      target/arm: Always pass cacheattr to get_phys_addr
      target/arm: Cache the Tagged bit for a page in MemTxAttrs
      target/arm: Create tagged ram when MTE is enabled
      target/arm: Add allocation tag storage for system mode
      target/arm: Enable MTE

From: Philippe Mathieu-Daudé <f4bug@amsat.org>

I'm confused by this code, 'bmc' is created as:

bmc = g_new0(AspeedBoardState, 1);

Then we use it as QOM owner for different MemoryRegion objects.
But looking at memory_region_init_ram (similarly for ROM):

void memory_region_init_ram(MemoryRegion *mr,
                              struct Object *owner,
                              const char *name,
                              uint64_t size,
                              Error **errp)
  {
      DeviceState *owner_dev;
      Error *err = NULL;

memory_region_init_ram_nomigrate(mr, owner, name, size, &err);
      if (err) {
          error_propagate(errp, err);
          return;
      }
      /* This will assert if owner is neither NULL nor a DeviceState.
       * We only want the owner here for the purposes of defining a
       * unique name for migration. TODO: Ideally we should implement
       * a naming scheme for Objects which are not DeviceStates, in
       * which case we can relax this restriction.
       */
      owner_dev = DEVICE(owner);
      vmstate_register_ram(mr, owner_dev);
  }

The expected assertion is not triggered ('bmc' is not NULL neither
a DeviceState).

'bmc' structure is defined as:

struct AspeedBoardState {
      AspeedSoCState soc;
      MemoryRegion ram_container;
      MemoryRegion max_ram;
  };

What happens is when using 'OBJECT(bmc)', the QOM macros cast the
memory pointed by bmc, which first member is 'soc', which is
initialized ...:

object_initialize_child(OBJECT(machine), "soc",
                          &bmc->soc, amc->soc_name);

The 'soc' object is indeed a DeviceState, so the assertion passes.

Since this is fragile and only happens to work by luck, remove the
dangerous OBJECT(bmc) owner argument.

Note, this probably breaks migration for this machine.

Reviewed-by: Cédric Le Goater <clg@kaod.org>
Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Message-id: 20200623072132.2868-2-f4bug@amsat.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/arm/aspeed.c | 6 +++---
 1 file changed, 3 insertions(+), 3 deletions(-)

diff --git a/hw/arm/aspeed.c b/hw/arm/aspeed.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/aspeed.c
+++ b/hw/arm/aspeed.c
@@ -XXX,XX +XXX,XX @@ static void aspeed_machine_init(MachineState *machine)
          * needed by the flash modules of the Aspeed machines.
          */
         if (ASPEED_MACHINE(machine)->mmio_exec) {
-            memory_region_init_alias(boot_rom, OBJECT(bmc), "aspeed.boot_rom",
+            memory_region_init_alias(boot_rom, NULL, "aspeed.boot_rom",
                                      &fl->mmio, 0, fl->size);
             memory_region_add_subregion(get_system_memory(), FIRMWARE_ADDR,
                                         boot_rom);
         } else {
-            memory_region_init_rom(boot_rom, OBJECT(bmc), "aspeed.boot_rom",
+            memory_region_init_rom(boot_rom, NULL, "aspeed.boot_rom",
                                    fl->size, &error_abort);
             memory_region_add_subregion(get_system_memory(), FIRMWARE_ADDR,
                                         boot_rom);
@@ -XXX,XX +XXX,XX @@ static void aspeed_machine_init(MachineState *machine)
     if (machine->kernel_filename && sc->num_cpus > 1) {
         /* With no u-boot we must set up a boot stub for the secondary CPU */
         MemoryRegion *smpboot = g_new(MemoryRegion, 1);
-        memory_region_init_ram(smpboot, OBJECT(bmc), "aspeed.smpboot",
+        memory_region_init_ram(smpboot, NULL, "aspeed.smpboot",
                                0x80, &error_abort);
         memory_region_add_subregion(get_system_memory(),
                                     AST_SMP_MAILBOX_BASE, smpboot);
-- 
2.20.1

From: Philippe Mathieu-Daudé <f4bug@amsat.org>

To have a more consistent naming, rename AspeedBoardState
as AspeedMachineState.

Suggested-by: Cédric Le Goater <clg@kaod.org>
Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Reviewed-by: Cédric Le Goater <clg@kaod.org>
Message-id: 20200623072132.2868-3-f4bug@amsat.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/arm/aspeed.h |  4 ++--
 hw/arm/aspeed.c         | 20 ++++++++++----------
 2 files changed, 12 insertions(+), 12 deletions(-)

diff --git a/include/hw/arm/aspeed.h b/include/hw/arm/aspeed.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/arm/aspeed.h
+++ b/include/hw/arm/aspeed.h
@@ -XXX,XX +XXX,XX @@
 
 #include "hw/boards.h"
 
-typedef struct AspeedBoardState AspeedBoardState;
+typedef struct AspeedMachineState AspeedMachineState;
 
 #define TYPE_ASPEED_MACHINE       MACHINE_TYPE_NAME("aspeed")
 #define ASPEED_MACHINE(obj) \
@@ -XXX,XX +XXX,XX @@ typedef struct AspeedMachineClass {
     const char *spi_model;
     uint32_t num_cs;
     uint32_t macs_mask;
-    void (*i2c_init)(AspeedBoardState *bmc);
+    void (*i2c_init)(AspeedMachineState *bmc);
 } AspeedMachineClass;
 
 
diff --git a/hw/arm/aspeed.c b/hw/arm/aspeed.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/aspeed.c
+++ b/hw/arm/aspeed.c
@@ -XXX,XX +XXX,XX @@ static struct arm_boot_info aspeed_board_binfo = {
     .board_id = -1, /* device-tree-only board */
 };
 
-struct AspeedBoardState {
+struct AspeedMachineState {
     AspeedSoCState soc;
     MemoryRegion ram_container;
     MemoryRegion max_ram;
@@ -XXX,XX +XXX,XX @@ static void sdhci_attach_drive(SDHCIState *sdhci, DriveInfo *dinfo)
 
 static void aspeed_machine_init(MachineState *machine)
 {
-    AspeedBoardState *bmc;
+    AspeedMachineState *bmc;
     AspeedMachineClass *amc = ASPEED_MACHINE_GET_CLASS(machine);
     AspeedSoCClass *sc;
     DriveInfo *drive0 = drive_get(IF_MTD, 0, 0);
@@ -XXX,XX +XXX,XX @@ static void aspeed_machine_init(MachineState *machine)
     int i;
     NICInfo *nd = &nd_table[0];
 
-    bmc = g_new0(AspeedBoardState, 1);
+    bmc = g_new0(AspeedMachineState, 1);
 
     memory_region_init(&bmc->ram_container, NULL, "aspeed-ram-container",
                        4 * GiB);
@@ -XXX,XX +XXX,XX @@ static void aspeed_machine_init(MachineState *machine)
     arm_load_kernel(ARM_CPU(first_cpu), machine, &aspeed_board_binfo);
 }
 
-static void palmetto_bmc_i2c_init(AspeedBoardState *bmc)
+static void palmetto_bmc_i2c_init(AspeedMachineState *bmc)
 {
     AspeedSoCState *soc = &bmc->soc;
     DeviceState *dev;
@@ -XXX,XX +XXX,XX @@ static void palmetto_bmc_i2c_init(AspeedBoardState *bmc)
     object_property_set_int(OBJECT(dev), 110000, "temperature3", &error_abort);
 }
 
-static void ast2500_evb_i2c_init(AspeedBoardState *bmc)
+static void ast2500_evb_i2c_init(AspeedMachineState *bmc)
 {
     AspeedSoCState *soc = &bmc->soc;
     uint8_t *eeprom_buf = g_malloc0(8 * 1024);
@@ -XXX,XX +XXX,XX @@ static void ast2500_evb_i2c_init(AspeedBoardState *bmc)
     i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 11), "ds1338", 0x32);
 }
 
-static void ast2600_evb_i2c_init(AspeedBoardState *bmc)
+static void ast2600_evb_i2c_init(AspeedMachineState *bmc)
 {
     /* Start with some devices on our I2C busses */
     ast2500_evb_i2c_init(bmc);
 }
 
-static void romulus_bmc_i2c_init(AspeedBoardState *bmc)
+static void romulus_bmc_i2c_init(AspeedMachineState *bmc)
 {
     AspeedSoCState *soc = &bmc->soc;
 
@@ -XXX,XX +XXX,XX @@ static void romulus_bmc_i2c_init(AspeedBoardState *bmc)
     i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 11), "ds1338", 0x32);
 }
 
-static void swift_bmc_i2c_init(AspeedBoardState *bmc)
+static void swift_bmc_i2c_init(AspeedMachineState *bmc)
 {
     AspeedSoCState *soc = &bmc->soc;
 
@@ -XXX,XX +XXX,XX @@ static void swift_bmc_i2c_init(AspeedBoardState *bmc)
     i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 12), "tmp105", 0x4a);
 }
 
-static void sonorapass_bmc_i2c_init(AspeedBoardState *bmc)
+static void sonorapass_bmc_i2c_init(AspeedMachineState *bmc)
 {
     AspeedSoCState *soc = &bmc->soc;
 
@@ -XXX,XX +XXX,XX @@ static void sonorapass_bmc_i2c_init(AspeedBoardState *bmc)
 
 }
 
-static void witherspoon_bmc_i2c_init(AspeedBoardState *bmc)
+static void witherspoon_bmc_i2c_init(AspeedMachineState *bmc)
 {
     AspeedSoCState *soc = &bmc->soc;
     uint8_t *eeprom_buf = g_malloc0(8 * 1024);
-- 
2.20.1

From: Philippe Mathieu-Daudé <f4bug@amsat.org>

AspeedMachineState seems crippled. We use incorrectly 2
different structures to do the same thing. Merge them
altogether:
- Move AspeedMachine fields to AspeedMachineState
- AspeedMachineState is now QOM
- Remove unused AspeedMachine structure

Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Reviewed-by: Cédric Le Goater <clg@kaod.org>
Message-id: 20200623072132.2868-4-f4bug@amsat.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/arm/aspeed.h |  8 +-------
 hw/arm/aspeed.c         | 11 +++++++----
 2 files changed, 8 insertions(+), 11 deletions(-)

diff --git a/include/hw/arm/aspeed.h b/include/hw/arm/aspeed.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/arm/aspeed.h
+++ b/include/hw/arm/aspeed.h
@@ -XXX,XX +XXX,XX @@ typedef struct AspeedMachineState AspeedMachineState;
 
 #define TYPE_ASPEED_MACHINE       MACHINE_TYPE_NAME("aspeed")
 #define ASPEED_MACHINE(obj) \
-    OBJECT_CHECK(AspeedMachine, (obj), TYPE_ASPEED_MACHINE)
-
-typedef struct AspeedMachine {
-    MachineState parent_obj;
-
-    bool mmio_exec;
-} AspeedMachine;
+    OBJECT_CHECK(AspeedMachineState, (obj), TYPE_ASPEED_MACHINE)
 
 #define ASPEED_MAC0_ON   (1 << 0)
 #define ASPEED_MAC1_ON   (1 << 1)
diff --git a/hw/arm/aspeed.c b/hw/arm/aspeed.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/aspeed.c
+++ b/hw/arm/aspeed.c
@@ -XXX,XX +XXX,XX @@ static struct arm_boot_info aspeed_board_binfo = {
 };
 
 struct AspeedMachineState {
+    /* Private */
+    MachineState parent_obj;
+    /* Public */
+
     AspeedSoCState soc;
     MemoryRegion ram_container;
     MemoryRegion max_ram;
+    bool mmio_exec;
 };
 
 /* Palmetto hardware value: 0x120CE416 */
@@ -XXX,XX +XXX,XX @@ static void sdhci_attach_drive(SDHCIState *sdhci, DriveInfo *dinfo)
 
 static void aspeed_machine_init(MachineState *machine)
 {
-    AspeedMachineState *bmc;
+    AspeedMachineState *bmc = ASPEED_MACHINE(machine);
     AspeedMachineClass *amc = ASPEED_MACHINE_GET_CLASS(machine);
     AspeedSoCClass *sc;
     DriveInfo *drive0 = drive_get(IF_MTD, 0, 0);
@@ -XXX,XX +XXX,XX @@ static void aspeed_machine_init(MachineState *machine)
     int i;
     NICInfo *nd = &nd_table[0];
 
-    bmc = g_new0(AspeedMachineState, 1);
-
     memory_region_init(&bmc->ram_container, NULL, "aspeed-ram-container",
                        4 * GiB);
     memory_region_add_subregion(&bmc->ram_container, 0, machine->ram);
@@ -XXX,XX +XXX,XX @@ static const TypeInfo aspeed_machine_types[] = {
     }, {
         .name          = TYPE_ASPEED_MACHINE,
         .parent        = TYPE_MACHINE,
-        .instance_size = sizeof(AspeedMachine),
+        .instance_size = sizeof(AspeedMachineState),
         .instance_init = aspeed_machine_instance_init,
         .class_size    = sizeof(AspeedMachineClass),
         .class_init    = aspeed_machine_class_init,
-- 
2.20.1

From: Philippe Mathieu-Daudé <f4bug@amsat.org>

Extract i2c_try_create_slave() and i2c_realize_and_unref()
from i2c_create_slave().
We can now set properties on a I2CSlave before it is realized.

This is in line with the recent qdev/QOM changes merged
in commit 6675a653d2e.

Reviewed-by: Corey Minyard <cminyard@mvista.com>
Reviewed-by: Cédric Le Goater <clg@kaod.org>
Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Reviewed-by: Markus Armbruster <armbru@redhat.com>
Tested-by: Cédric Le Goater <clg@kaod.org>
Message-id: 20200623072723.6324-2-f4bug@amsat.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/i2c/i2c.h |  2 ++
 hw/i2c/core.c        | 18 ++++++++++++++++--
 2 files changed, 18 insertions(+), 2 deletions(-)

diff --git a/include/hw/i2c/i2c.h b/include/hw/i2c/i2c.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/i2c/i2c.h
+++ b/include/hw/i2c/i2c.h
@@ -XXX,XX +XXX,XX @@ int i2c_send(I2CBus *bus, uint8_t data);
 uint8_t i2c_recv(I2CBus *bus);
 
 DeviceState *i2c_create_slave(I2CBus *bus, const char *name, uint8_t addr);
+DeviceState *i2c_try_create_slave(const char *name, uint8_t addr);
+bool i2c_realize_and_unref(DeviceState *dev, I2CBus *bus, Error **errp);
 
 /* lm832x.c */
 void lm832x_key_event(DeviceState *dev, int key, int state);
diff --git a/hw/i2c/core.c b/hw/i2c/core.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/i2c/core.c
+++ b/hw/i2c/core.c
@@ -XXX,XX +XXX,XX @@ const VMStateDescription vmstate_i2c_slave = {
     }
 };
 
-DeviceState *i2c_create_slave(I2CBus *bus, const char *name, uint8_t addr)
+DeviceState *i2c_try_create_slave(const char *name, uint8_t addr)
 {
     DeviceState *dev;
 
     dev = qdev_new(name);
     qdev_prop_set_uint8(dev, "address", addr);
-    qdev_realize_and_unref(dev, &bus->qbus, &error_fatal);
+    return dev;
+}
+
+bool i2c_realize_and_unref(DeviceState *dev, I2CBus *bus, Error **errp)
+{
+    return qdev_realize_and_unref(dev, &bus->qbus, errp);
+}
+
+DeviceState *i2c_create_slave(I2CBus *bus, const char *name, uint8_t addr)
+{
+    DeviceState *dev;
+
+    dev = i2c_try_create_slave(name, addr);
+    i2c_realize_and_unref(dev, bus, &error_fatal);
+
     return dev;
 }
 
-- 
2.20.1

From: Philippe Mathieu-Daudé <f4bug@amsat.org>

The PCA9552 device does not expose LEDs, but simple pins
to connnect LEDs to. To be clearer with the device model,
rename 'nr_leds' as 'pin_count'.

Reviewed-by: Cédric Le Goater <clg@kaod.org>
Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Tested-by: Cédric Le Goater <clg@kaod.org>
Message-id: 20200623072723.6324-3-f4bug@amsat.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/misc/pca9552.h |  2 +-
 hw/misc/pca9552.c         | 10 +++++-----
 2 files changed, 6 insertions(+), 6 deletions(-)

diff --git a/include/hw/misc/pca9552.h b/include/hw/misc/pca9552.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/misc/pca9552.h
+++ b/include/hw/misc/pca9552.h
@@ -XXX,XX +XXX,XX @@ typedef struct PCA9552State {
 
     uint8_t regs[PCA9552_NR_REGS];
     uint8_t max_reg;
-    uint8_t nr_leds;
+    uint8_t pin_count;
 } PCA9552State;
 
 #endif
diff --git a/hw/misc/pca9552.c b/hw/misc/pca9552.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/misc/pca9552.c
+++ b/hw/misc/pca9552.c
@@ -XXX,XX +XXX,XX @@ static void pca9552_update_pin_input(PCA9552State *s)
 {
     int i;
 
-    for (i = 0; i < s->nr_leds; i++) {
+    for (i = 0; i < s->pin_count; i++) {
         uint8_t input_reg = PCA9552_INPUT0 + (i / 8);
         uint8_t input_shift = (i % 8);
         uint8_t config = pca9552_pin_get_config(s, i);
@@ -XXX,XX +XXX,XX @@ static void pca9552_get_led(Object *obj, Visitor *v, const char *name,
         error_setg(errp, "%s: error reading %s", __func__, name);
         return;
     }
-    if (led < 0 || led > s->nr_leds) {
+    if (led < 0 || led > s->pin_count) {
         error_setg(errp, "%s invalid led %s", __func__, name);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void pca9552_set_led(Object *obj, Visitor *v, const char *name,
         error_setg(errp, "%s: error reading %s", __func__, name);
         return;
     }
-    if (led < 0 || led > s->nr_leds) {
+    if (led < 0 || led > s->pin_count) {
         error_setg(errp, "%s invalid led %s", __func__, name);
         return;
     }
@@ -XXX,XX +XXX,XX @@ static void pca9552_initfn(Object *obj)
      * PCA955X device
      */
     s->max_reg = PCA9552_LS3;
-    s->nr_leds = 16;
+    s->pin_count = 16;
 
-    for (led = 0; led < s->nr_leds; led++) {
+    for (led = 0; led < s->pin_count; led++) {
         char *name;
 
         name = g_strdup_printf("led%d", led);
-- 
2.20.1

From: Philippe Mathieu-Daudé <f4bug@amsat.org>

Various code from the PCA9552 device model is generic to the
PCA955X family. We'll split the generic code in a base class
in the next commit. To ease review, first do a dumb renaming.

Reviewed-by: Cédric Le Goater <clg@kaod.org>
Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Tested-by: Cédric Le Goater <clg@kaod.org>
Message-id: 20200623072723.6324-4-f4bug@amsat.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/misc/pca9552.h | 10 ++---
 hw/misc/pca9552.c         | 80 +++++++++++++++++++--------------------
 2 files changed, 45 insertions(+), 45 deletions(-)

diff --git a/include/hw/misc/pca9552.h b/include/hw/misc/pca9552.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/misc/pca9552.h
+++ b/include/hw/misc/pca9552.h
@@ -XXX,XX +XXX,XX @@
 #include "hw/i2c/i2c.h"
 
 #define TYPE_PCA9552 "pca9552"
-#define PCA9552(obj) OBJECT_CHECK(PCA9552State, (obj), TYPE_PCA9552)
+#define PCA955X(obj) OBJECT_CHECK(PCA955xState, (obj), TYPE_PCA9552)
 
-#define PCA9552_NR_REGS 10
+#define PCA955X_NR_REGS 10
 
-typedef struct PCA9552State {
+typedef struct PCA955xState {
     /*< private >*/
     I2CSlave i2c;
     /*< public >*/
@@ -XXX,XX +XXX,XX @@ typedef struct PCA9552State {
     uint8_t len;
     uint8_t pointer;
 
-    uint8_t regs[PCA9552_NR_REGS];
+    uint8_t regs[PCA955X_NR_REGS];
     uint8_t max_reg;
     uint8_t pin_count;
-} PCA9552State;
+} PCA955xState;
 
 #endif
diff --git a/hw/misc/pca9552.c b/hw/misc/pca9552.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/misc/pca9552.c
+++ b/hw/misc/pca9552.c
@@ -XXX,XX +XXX,XX @@
 
 static const char *led_state[] = {"on", "off", "pwm0", "pwm1"};
 
-static uint8_t pca9552_pin_get_config(PCA9552State *s, int pin)
+static uint8_t pca955x_pin_get_config(PCA955xState *s, int pin)
 {
     uint8_t reg   = PCA9552_LS0 + (pin / 4);
     uint8_t shift = (pin % 4) << 1;
@@ -XXX,XX +XXX,XX @@ static uint8_t pca9552_pin_get_config(PCA9552State *s, int pin)
     return extract32(s->regs[reg], shift, 2);
 }
 
-static void pca9552_update_pin_input(PCA9552State *s)
+static void pca955x_update_pin_input(PCA955xState *s)
 {
     int i;
 
     for (i = 0; i < s->pin_count; i++) {
         uint8_t input_reg = PCA9552_INPUT0 + (i / 8);
         uint8_t input_shift = (i % 8);
-        uint8_t config = pca9552_pin_get_config(s, i);
+        uint8_t config = pca955x_pin_get_config(s, i);
 
         switch (config) {
         case PCA9552_LED_ON:
@@ -XXX,XX +XXX,XX @@ static void pca9552_update_pin_input(PCA9552State *s)
     }
 }
 
-static uint8_t pca9552_read(PCA9552State *s, uint8_t reg)
+static uint8_t pca955x_read(PCA955xState *s, uint8_t reg)
 {
     switch (reg) {
     case PCA9552_INPUT0:
@@ -XXX,XX +XXX,XX @@ static uint8_t pca9552_read(PCA9552State *s, uint8_t reg)
     }
 }
 
-static void pca9552_write(PCA9552State *s, uint8_t reg, uint8_t data)
+static void pca955x_write(PCA955xState *s, uint8_t reg, uint8_t data)
 {
     switch (reg) {
     case PCA9552_PSC0:
@@ -XXX,XX +XXX,XX @@ static void pca9552_write(PCA9552State *s, uint8_t reg, uint8_t data)
     case PCA9552_LS2:
     case PCA9552_LS3:
         s->regs[reg] = data;
-        pca9552_update_pin_input(s);
+        pca955x_update_pin_input(s);
         break;
 
     case PCA9552_INPUT0:
@@ -XXX,XX +XXX,XX @@ static void pca9552_write(PCA9552State *s, uint8_t reg, uint8_t data)
  * after each byte is sent to or received by the device. The index
  * rollovers to 0 when the maximum register address is reached.
  */
-static void pca9552_autoinc(PCA9552State *s)
+static void pca955x_autoinc(PCA955xState *s)
 {
     if (s->pointer != 0xFF && s->pointer & PCA9552_AUTOINC) {
         uint8_t reg = s->pointer & 0xf;
@@ -XXX,XX +XXX,XX @@ static void pca9552_autoinc(PCA9552State *s)
     }
 }
 
-static uint8_t pca9552_recv(I2CSlave *i2c)
+static uint8_t pca955x_recv(I2CSlave *i2c)
 {
-    PCA9552State *s = PCA9552(i2c);
+    PCA955xState *s = PCA955X(i2c);
     uint8_t ret;
 
-    ret = pca9552_read(s, s->pointer & 0xf);
+    ret = pca955x_read(s, s->pointer & 0xf);
 
     /*
      * From the Specs:
@@ -XXX,XX +XXX,XX @@ static uint8_t pca9552_recv(I2CSlave *i2c)
                       __func__);
     }
 
-    pca9552_autoinc(s);
+    pca955x_autoinc(s);
 
     return ret;
 }
 
-static int pca9552_send(I2CSlave *i2c, uint8_t data)
+static int pca955x_send(I2CSlave *i2c, uint8_t data)
 {
-    PCA9552State *s = PCA9552(i2c);
+    PCA955xState *s = PCA955X(i2c);
 
     /* First byte sent by is the register address */
     if (s->len == 0) {
         s->pointer = data;
         s->len++;
     } else {
-        pca9552_write(s, s->pointer & 0xf, data);
+        pca955x_write(s, s->pointer & 0xf, data);
 
-        pca9552_autoinc(s);
+        pca955x_autoinc(s);
     }
 
     return 0;
 }
 
-static int pca9552_event(I2CSlave *i2c, enum i2c_event event)
+static int pca955x_event(I2CSlave *i2c, enum i2c_event event)
 {
-    PCA9552State *s = PCA9552(i2c);
+    PCA955xState *s = PCA955X(i2c);
 
     s->len = 0;
     return 0;
 }
 
-static void pca9552_get_led(Object *obj, Visitor *v, const char *name,
+static void pca955x_get_led(Object *obj, Visitor *v, const char *name,
                             void *opaque, Error **errp)
 {
-    PCA9552State *s = PCA9552(obj);
+    PCA955xState *s = PCA955X(obj);
     int led, rc, reg;
     uint8_t state;
 
@@ -XXX,XX +XXX,XX @@ static void pca9552_get_led(Object *obj, Visitor *v, const char *name,
      * reading the INPUTx reg
      */
     reg = PCA9552_LS0 + led / 4;
-    state = (pca9552_read(s, reg) >> (led % 8)) & 0x3;
+    state = (pca955x_read(s, reg) >> (led % 8)) & 0x3;
     visit_type_str(v, name, (char **)&led_state[state], errp);
 }
 
@@ -XXX,XX +XXX,XX @@ static inline uint8_t pca955x_ledsel(uint8_t oldval, int led_num, int state)
                 ((state & 0x3) << (led_num << 1));
 }
 
-static void pca9552_set_led(Object *obj, Visitor *v, const char *name,
+static void pca955x_set_led(Object *obj, Visitor *v, const char *name,
                             void *opaque, Error **errp)
 {
-    PCA9552State *s = PCA9552(obj);
+    PCA955xState *s = PCA955X(obj);
     Error *local_err = NULL;
     int led, rc, reg, val;
     uint8_t state;
@@ -XXX,XX +XXX,XX @@ static void pca9552_set_led(Object *obj, Visitor *v, const char *name,
     }
 
     reg = PCA9552_LS0 + led / 4;
-    val = pca9552_read(s, reg);
+    val = pca955x_read(s, reg);
     val = pca955x_ledsel(val, led % 4, state);
-    pca9552_write(s, reg, val);
+    pca955x_write(s, reg, val);
 }
 
 static const VMStateDescription pca9552_vmstate = {
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription pca9552_vmstate = {
     .version_id = 0,
     .minimum_version_id = 0,
     .fields = (VMStateField[]) {
-        VMSTATE_UINT8(len, PCA9552State),
-        VMSTATE_UINT8(pointer, PCA9552State),
-        VMSTATE_UINT8_ARRAY(regs, PCA9552State, PCA9552_NR_REGS),
-        VMSTATE_I2C_SLAVE(i2c, PCA9552State),
+        VMSTATE_UINT8(len, PCA955xState),
+        VMSTATE_UINT8(pointer, PCA955xState),
+        VMSTATE_UINT8_ARRAY(regs, PCA955xState, PCA955X_NR_REGS),
+        VMSTATE_I2C_SLAVE(i2c, PCA955xState),
         VMSTATE_END_OF_LIST()
     }
 };
 
 static void pca9552_reset(DeviceState *dev)
 {
-    PCA9552State *s = PCA9552(dev);
+    PCA955xState *s = PCA955X(dev);
 
     s->regs[PCA9552_PSC0] = 0xFF;
     s->regs[PCA9552_PWM0] = 0x80;
@@ -XXX,XX +XXX,XX @@ static void pca9552_reset(DeviceState *dev)
     s->regs[PCA9552_LS2] = 0x55;
     s->regs[PCA9552_LS3] = 0x55;
 
-    pca9552_update_pin_input(s);
+    pca955x_update_pin_input(s);
 
     s->pointer = 0xFF;
     s->len = 0;
 }
 
-static void pca9552_initfn(Object *obj)
+static void pca955x_initfn(Object *obj)
 {
-    PCA9552State *s = PCA9552(obj);
+    PCA955xState *s = PCA955X(obj);
     int led;
 
     /* If support for the other PCA955X devices are implemented, these
@@ -XXX,XX +XXX,XX @@ static void pca9552_initfn(Object *obj)
         char *name;
 
         name = g_strdup_printf("led%d", led);
-        object_property_add(obj, name, "bool", pca9552_get_led, pca9552_set_led,
+        object_property_add(obj, name, "bool", pca955x_get_led, pca955x_set_led,
                             NULL, NULL);
         g_free(name);
     }
@@ -XXX,XX +XXX,XX @@ static void pca9552_class_init(ObjectClass *klass, void *data)
     DeviceClass *dc = DEVICE_CLASS(klass);
     I2CSlaveClass *k = I2C_SLAVE_CLASS(klass);
 
-    k->event = pca9552_event;
-    k->recv = pca9552_recv;
-    k->send = pca9552_send;
+    k->event = pca955x_event;
+    k->recv = pca955x_recv;
+    k->send = pca955x_send;
     dc->reset = pca9552_reset;
     dc->vmsd = &pca9552_vmstate;
 }
@@ -XXX,XX +XXX,XX @@ static void pca9552_class_init(ObjectClass *klass, void *data)
 static const TypeInfo pca9552_info = {
     .name          = TYPE_PCA9552,
     .parent        = TYPE_I2C_SLAVE,
-    .instance_init = pca9552_initfn,
-    .instance_size = sizeof(PCA9552State),
+    .instance_init = pca955x_initfn,
+    .instance_size = sizeof(PCA955xState),
     .class_init    = pca9552_class_init,
 };
 
-static void pca9552_register_types(void)
+static void pca955x_register_types(void)
 {
     type_register_static(&pca9552_info);
 }
 
-type_init(pca9552_register_types)
+type_init(pca955x_register_types)
-- 
2.20.1

From: Philippe Mathieu-Daudé <f4bug@amsat.org>

Extract the code common to the PCA955x family in PCA955xClass,
keeping the PCA9552 specific parts into pca9552_class_init().
Remove the 'TODO' comment added in commit 5141d4158cf.

Suggested-by: Cédric Le Goater <clg@kaod.org>
Reviewed-by: Cédric Le Goater <clg@kaod.org>
Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Tested-by: Cédric Le Goater <clg@kaod.org>
Message-id: 20200623072723.6324-5-f4bug@amsat.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/misc/pca9552.h |  6 ++--
 hw/misc/pca9552.c         | 66 ++++++++++++++++++++++++++++-----------
 2 files changed, 51 insertions(+), 21 deletions(-)

From: Philippe Mathieu-Daudé <f4bug@amsat.org>

Add a description field to distinguish between multiple devices.

Reviewed-by: Cédric Le Goater <clg@kaod.org>
Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Tested-by: Cédric Le Goater <clg@kaod.org>
Message-id: 20200623072723.6324-6-f4bug@amsat.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/misc/pca9552.h |  1 +
 hw/misc/pca9552.c         | 18 ++++++++++++++++++
 2 files changed, 19 insertions(+)

diff --git a/include/hw/misc/pca9552.h b/include/hw/misc/pca9552.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/misc/pca9552.h
+++ b/include/hw/misc/pca9552.h
@@ -XXX,XX +XXX,XX @@ typedef struct PCA955xState {
     uint8_t pointer;
 
     uint8_t regs[PCA955X_NR_REGS];
+    char *description; /* For debugging purpose only */
 } PCA955xState;
 
 #endif
diff --git a/hw/misc/pca9552.c b/hw/misc/pca9552.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/misc/pca9552.c
+++ b/hw/misc/pca9552.c
@@ -XXX,XX +XXX,XX @@
 #include "qemu/osdep.h"
 #include "qemu/log.h"
 #include "qemu/module.h"
+#include "hw/qdev-properties.h"
 #include "hw/misc/pca9552.h"
 #include "hw/misc/pca9552_regs.h"
 #include "migration/vmstate.h"
@@ -XXX,XX +XXX,XX @@ static void pca955x_initfn(Object *obj)
     }
 }
 
+static void pca955x_realize(DeviceState *dev, Error **errp)
+{
+    PCA955xState *s = PCA955X(dev);
+
+    if (!s->description) {
+        s->description = g_strdup("pca-unspecified");
+    }
+}
+
+static Property pca955x_properties[] = {
+    DEFINE_PROP_STRING("description", PCA955xState, description),
+    DEFINE_PROP_END_OF_LIST(),
+};
+
 static void pca955x_class_init(ObjectClass *klass, void *data)
 {
+    DeviceClass *dc = DEVICE_CLASS(klass);
     I2CSlaveClass *k = I2C_SLAVE_CLASS(klass);
 
     k->event = pca955x_event;
     k->recv = pca955x_recv;
     k->send = pca955x_send;
+    dc->realize = pca955x_realize;
+    device_class_set_props(dc, pca955x_properties);
 }
 
 static const TypeInfo pca955x_info = {
-- 
2.20.1

From: Philippe Mathieu-Daudé <f4bug@amsat.org>

Add a trivial representation of the PCA9552 GPIOs.

Example booting obmc-phosphor-image:

$ qemu-system-arm -M witherspoon-bmc -trace pca955x_gpio_status
  1592689902.327837:pca955x_gpio_status pca-unspecified GPIOs 0-15 [*...............]
  1592689902.329934:pca955x_gpio_status pca-unspecified GPIOs 0-15 [**..............]
  1592689902.330717:pca955x_gpio_status pca-unspecified GPIOs 0-15 [***.............]
  1592689902.331431:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****............]
  1592689902.332163:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****.........*..]
  1592689902.332888:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****.........**.]
  1592689902.333629:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****.........***]
  1592690032.793289:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****.........*.*]
  1592690033.303163:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****.........***]
  1592690033.812962:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****.........*.*]
  1592690034.323234:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****.........***]
  1592690034.832922:pca955x_gpio_status pca-unspecified GPIOs 0-15 [****.........*.*]

We notice the GPIO #14 (front-power LED) starts to blink.

This LED is described in the witherspoon device-tree [*]:

front-power {
      retain-state-shutdown;
      default-state = "keep";
      gpios = <&pca0 14 GPIO_ACTIVE_LOW>;
  };

[*] https://git.kernel.org/pub/scm/linux/kernel/git/torvalds/linux.git/tree/arch/arm/boot/dts/aspeed-bmc-opp-witherspoon.dts?id=b1f9be9392f0#n140

Suggested-by: Cédric Le Goater <clg@kaod.org>
Reviewed-by: Cédric Le Goater <clg@kaod.org>
Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Tested-by: Cédric Le Goater <clg@kaod.org>
Message-id: 20200623072723.6324-7-f4bug@amsat.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/misc/pca9552.c    | 39 +++++++++++++++++++++++++++++++++++++++
 hw/misc/trace-events |  3 +++
 2 files changed, 42 insertions(+)

diff --git a/hw/misc/pca9552.c b/hw/misc/pca9552.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/misc/pca9552.c
+++ b/hw/misc/pca9552.c
@@ -XXX,XX +XXX,XX @@
 #include "qemu/osdep.h"
 #include "qemu/log.h"
 #include "qemu/module.h"
+#include "qemu/bitops.h"
 #include "hw/qdev-properties.h"
 #include "hw/misc/pca9552.h"
 #include "hw/misc/pca9552_regs.h"
 #include "migration/vmstate.h"
 #include "qapi/error.h"
 #include "qapi/visitor.h"
+#include "trace.h"
 
 typedef struct PCA955xClass {
     /*< private >*/
@@ -XXX,XX +XXX,XX @@ static uint8_t pca955x_pin_get_config(PCA955xState *s, int pin)
     return extract32(s->regs[reg], shift, 2);
 }
 
+/* Return INPUT status (bit #N belongs to GPIO #N) */
+static uint16_t pca955x_pins_get_status(PCA955xState *s)
+{
+    return (s->regs[PCA9552_INPUT1] << 8) | s->regs[PCA9552_INPUT0];
+}
+
+static void pca955x_display_pins_status(PCA955xState *s,
+                                        uint16_t previous_pins_status)
+{
+    PCA955xClass *k = PCA955X_GET_CLASS(s);
+    uint16_t pins_status, pins_changed;
+    int i;
+
+    pins_status = pca955x_pins_get_status(s);
+    pins_changed = previous_pins_status ^ pins_status;
+    if (!pins_changed) {
+        return;
+    }
+    if (trace_event_get_state_backends(TRACE_PCA955X_GPIO_STATUS)) {
+        char *buf = g_newa(char, k->pin_count + 1);
+
+        for (i = 0; i < k->pin_count; i++) {
+            if (extract32(pins_status, i, 1)) {
+                buf[i] = '*';
+            } else {
+                buf[i] = '.';
+            }
+        }
+        buf[i] = '\0';
+        trace_pca955x_gpio_status(s->description, buf);
+    }
+}
+
 static void pca955x_update_pin_input(PCA955xState *s)
 {
     PCA955xClass *k = PCA955X_GET_CLASS(s);
@@ -XXX,XX +XXX,XX @@ static uint8_t pca955x_read(PCA955xState *s, uint8_t reg)
 
 static void pca955x_write(PCA955xState *s, uint8_t reg, uint8_t data)
 {
+    uint16_t pins_status;
+
     switch (reg) {
     case PCA9552_PSC0:
     case PCA9552_PWM0:
@@ -XXX,XX +XXX,XX @@ static void pca955x_write(PCA955xState *s, uint8_t reg, uint8_t data)
     case PCA9552_LS1:
     case PCA9552_LS2:
     case PCA9552_LS3:
+        pins_status = pca955x_pins_get_status(s);
         s->regs[reg] = data;
         pca955x_update_pin_input(s);
+        pca955x_display_pins_status(s, pins_status);
         break;
 
     case PCA9552_INPUT0:
diff --git a/hw/misc/trace-events b/hw/misc/trace-events
index XXXXXXX..XXXXXXX 100644
--- a/hw/misc/trace-events
+++ b/hw/misc/trace-events
@@ -XXX,XX +XXX,XX @@ via1_adb_poll(uint8_t data, const char *vadbint, int status, int index, int size
 # grlib_ahb_apb_pnp.c
 grlib_ahb_pnp_read(uint64_t addr, uint32_t value) "AHB PnP read addr:0x%03"PRIx64" data:0x%08x"
 grlib_apb_pnp_read(uint64_t addr, uint32_t value) "APB PnP read addr:0x%03"PRIx64" data:0x%08x"
+
+# pca9552.c
+pca955x_gpio_status(const char *description, const char *buf) "%s GPIOs 0-15 [%s]"
-- 
2.20.1

From: Philippe Mathieu-Daudé <f4bug@amsat.org>

We have 2 distinct PCA9552 devices. Set their description
to distinguish them when looking at the trace events.

Description name taken from:
https://github.com/open-power/witherspoon-xml/blob/master/witherspoon.xml

Reviewed-by: Cédric Le Goater <clg@kaod.org>
Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Reviewed-by: Corey Minyard <cminyard@mvista.com>
Reviewed-by: Markus Armbruster <armbru@redhat.com>
Tested-by: Cédric Le Goater <clg@kaod.org>
Message-id: 20200623072723.6324-8-f4bug@amsat.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/arm/aspeed.c | 13 +++++++++----
 1 file changed, 9 insertions(+), 4 deletions(-)

diff --git a/hw/arm/aspeed.c b/hw/arm/aspeed.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/aspeed.c
+++ b/hw/arm/aspeed.c
@@ -XXX,XX +XXX,XX @@ static void witherspoon_bmc_i2c_init(AspeedMachineState *bmc)
 {
     AspeedSoCState *soc = &bmc->soc;
     uint8_t *eeprom_buf = g_malloc0(8 * 1024);
+    DeviceState *dev;
 
     /* Bus 3: TODO bmp280@77 */
     /* Bus 3: TODO max31785@52 */
     /* Bus 3: TODO dps310@76 */
-    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 3), TYPE_PCA9552,
-                     0x60);
+    dev = i2c_try_create_slave(TYPE_PCA9552, 0x60);
+    qdev_prop_set_string(dev, "description", "pca1");
+    i2c_realize_and_unref(dev, aspeed_i2c_get_bus(DEVICE(&soc->i2c), 3),
+                          &error_fatal);
 
     i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 4), "tmp423", 0x4c);
     i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 5), "tmp423", 0x4c);
@@ -XXX,XX +XXX,XX @@ static void witherspoon_bmc_i2c_init(AspeedMachineState *bmc)
 
     smbus_eeprom_init_one(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 11), 0x51,
                           eeprom_buf);
-    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 11), TYPE_PCA9552,
-                     0x60);
+    dev = i2c_try_create_slave(TYPE_PCA9552, 0x60);
+    qdev_prop_set_string(dev, "description", "pca0");
+    i2c_realize_and_unref(dev, aspeed_i2c_get_bus(DEVICE(&soc->i2c), 11),
+                          &error_fatal);
     /* Bus 11: TODO ucd90160@64 */
 }
 
-- 
2.20.1

From: Philippe Mathieu-Daudé <f4bug@amsat.org>

Emit a trace event when a GPIO change its state.

Example booting obmc-phosphor-image:

$ qemu-system-arm -M witherspoon-bmc -trace pca955x_gpio_change
  1592690552.687372:pca955x_gpio_change pca1 GPIO id:0 status: 0 -> 1
  1592690552.690169:pca955x_gpio_change pca1 GPIO id:1 status: 0 -> 1
  1592690552.691673:pca955x_gpio_change pca1 GPIO id:2 status: 0 -> 1
  1592690552.696886:pca955x_gpio_change pca1 GPIO id:3 status: 0 -> 1
  1592690552.698614:pca955x_gpio_change pca1 GPIO id:13 status: 0 -> 1
  1592690552.699833:pca955x_gpio_change pca1 GPIO id:14 status: 0 -> 1
  1592690552.700842:pca955x_gpio_change pca1 GPIO id:15 status: 0 -> 1
  1592690683.841921:pca955x_gpio_change pca1 GPIO id:14 status: 1 -> 0
  1592690683.861660:pca955x_gpio_change pca1 GPIO id:14 status: 0 -> 1
  1592690684.371460:pca955x_gpio_change pca1 GPIO id:14 status: 1 -> 0
  1592690684.882115:pca955x_gpio_change pca1 GPIO id:14 status: 0 -> 1
  1592690685.391411:pca955x_gpio_change pca1 GPIO id:14 status: 1 -> 0
  1592690685.901391:pca955x_gpio_change pca1 GPIO id:14 status: 0 -> 1
  1592690686.411678:pca955x_gpio_change pca1 GPIO id:14 status: 1 -> 0
  1592690686.921279:pca955x_gpio_change pca1 GPIO id:14 status: 0 -> 1

We notice the GPIO #14 (front-power LED) starts to blink.

This LED is described in the witherspoon device-tree [*]:

front-power {
      retain-state-shutdown;
      default-state = "keep";
      gpios = <&pca0 14 GPIO_ACTIVE_LOW>;
  };

[*] https://git.kernel.org/pub/scm/linux/kernel/git/torvalds/linux.git/tree/arch/arm/boot/dts/aspeed-bmc-opp-witherspoon.dts?id=b1f9be9392f0#n140

Reviewed-by: Cédric Le Goater <clg@kaod.org>
Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Tested-by: Cédric Le Goater <clg@kaod.org>
Message-id: 20200623072723.6324-9-f4bug@amsat.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/misc/pca9552.c    | 15 +++++++++++++++
 hw/misc/trace-events |  1 +
 2 files changed, 16 insertions(+)

diff --git a/hw/misc/pca9552.c b/hw/misc/pca9552.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/misc/pca9552.c
+++ b/hw/misc/pca9552.c
@@ -XXX,XX +XXX,XX @@ static void pca955x_display_pins_status(PCA955xState *s,
         buf[i] = '\0';
         trace_pca955x_gpio_status(s->description, buf);
     }
+    if (trace_event_get_state_backends(TRACE_PCA955X_GPIO_CHANGE)) {
+        for (i = 0; i < k->pin_count; i++) {
+            if (extract32(pins_changed, i, 1)) {
+                unsigned new_state = extract32(pins_status, i, 1);
+
+                /*
+                 * We display the state using the PCA logic ("active-high").
+                 * This is not the state of the LED, which signal might be
+                 * wired "active-low" on the board.
+                 */
+                trace_pca955x_gpio_change(s->description, i,
+                                          !new_state, new_state);
+            }
+        }
+    }
 }
 
 static void pca955x_update_pin_input(PCA955xState *s)
diff --git a/hw/misc/trace-events b/hw/misc/trace-events
index XXXXXXX..XXXXXXX 100644
--- a/hw/misc/trace-events
+++ b/hw/misc/trace-events
@@ -XXX,XX +XXX,XX @@ grlib_apb_pnp_read(uint64_t addr, uint32_t value) "APB PnP read addr:0x%03"PRIx6
 
 # pca9552.c
 pca955x_gpio_status(const char *description, const char *buf) "%s GPIOs 0-15 [%s]"
+pca955x_gpio_change(const char *description, unsigned id, unsigned prev_state, unsigned current_state) "%s GPIO id:%u status: %u -> %u"
-- 
2.20.1

From: Philippe Mathieu-Daudé <f4bug@amsat.org>

The PCA9552 has 16 GPIOs which can be used as input,
output or PWM mode. QEMU models the output GPIO with
the qemu_irq type. Let the device expose the 16 GPIOs
to allow us to later connect LEDs to these outputs.

Reviewed-by: Cédric Le Goater <clg@kaod.org>
Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Tested-by: Cédric Le Goater <clg@kaod.org>
Message-id: 20200623072723.6324-10-f4bug@amsat.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/misc/pca9552.h | 1 +
 hw/misc/pca9552.c         | 6 ++++++
 2 files changed, 7 insertions(+)

diff --git a/include/hw/misc/pca9552.h b/include/hw/misc/pca9552.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/misc/pca9552.h
+++ b/include/hw/misc/pca9552.h
@@ -XXX,XX +XXX,XX @@ typedef struct PCA955xState {
     uint8_t pointer;
 
     uint8_t regs[PCA955X_NR_REGS];
+    qemu_irq gpio[PCA955X_PIN_COUNT_MAX];
     char *description; /* For debugging purpose only */
 } PCA955xState;
 
diff --git a/hw/misc/pca9552.c b/hw/misc/pca9552.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/misc/pca9552.c
+++ b/hw/misc/pca9552.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/qdev-properties.h"
 #include "hw/misc/pca9552.h"
 #include "hw/misc/pca9552_regs.h"
+#include "hw/irq.h"
 #include "migration/vmstate.h"
 #include "qapi/error.h"
 #include "qapi/visitor.h"
@@ -XXX,XX +XXX,XX @@ static void pca955x_update_pin_input(PCA955xState *s)
 
         switch (config) {
         case PCA9552_LED_ON:
+            qemu_set_irq(s->gpio[i], 1);
             s->regs[input_reg] |= 1 << input_shift;
             break;
         case PCA9552_LED_OFF:
+            qemu_set_irq(s->gpio[i], 0);
             s->regs[input_reg] &= ~(1 << input_shift);
             break;
         case PCA9552_LED_PWM0:
@@ -XXX,XX +XXX,XX @@ static void pca955x_initfn(Object *obj)
 
 static void pca955x_realize(DeviceState *dev, Error **errp)
 {
+    PCA955xClass *k = PCA955X_GET_CLASS(dev);
     PCA955xState *s = PCA955X(dev);
 
     if (!s->description) {
         s->description = g_strdup("pca-unspecified");
     }
+
+    qdev_init_gpio_out(dev, s->gpio, k->pin_count);
 }
 
 static Property pca955x_properties[] = {
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-2-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h | 10 ++++++++++
 1 file changed, 10 insertions(+)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ static inline bool isar_feature_aa64_bti(const ARMISARegisters *id)
     return FIELD_EX64(id->id_aa64pfr1, ID_AA64PFR1, BT) != 0;
 }
 
+static inline bool isar_feature_aa64_mte_insn_reg(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64pfr1, ID_AA64PFR1, MTE) != 0;
+}
+
+static inline bool isar_feature_aa64_mte(const ARMISARegisters *id)
+{
+    return FIELD_EX64(id->id_aa64pfr1, ID_AA64PFR1, MTE) >= 2;
+}
+
 static inline bool isar_feature_aa64_pmu_8_1(const ARMISARegisters *id)
 {
     return FIELD_EX64(id->id_aa64dfr0, ID_AA64DFR0, PMUVER) >= 4 &&
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Protect reads of aa64 id registers with ARM_CP_STATE_AA64.
Use this as a simpler test than arm_el_is_aa64, since EL3
cannot change mode.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-3-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper.c | 15 ++++++++-------
 1 file changed, 8 insertions(+), 7 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void scr_write(CPUARMState *env, const ARMCPRegInfo *ri, uint64_t value)
     uint32_t valid_mask = 0x3fff;
     ARMCPU *cpu = env_archcpu(env);
 
-    if (arm_el_is_aa64(env, 3)) {
+    if (ri->state == ARM_CP_STATE_AA64) {
         value |= SCR_FW | SCR_AW;   /* these two bits are RES1.  */
         valid_mask &= ~SCR_NET;
+
+        if (cpu_isar_feature(aa64_lor, cpu)) {
+            valid_mask |= SCR_TLOR;
+        }
+        if (cpu_isar_feature(aa64_pauth, cpu)) {
+            valid_mask |= SCR_API | SCR_APK;
+        }
     } else {
         valid_mask &= ~(SCR_RW | SCR_ST);
     }
@@ -XXX,XX +XXX,XX @@ static void scr_write(CPUARMState *env, const ARMCPRegInfo *ri, uint64_t value)
             valid_mask &= ~SCR_SMD;
         }
     }
-    if (cpu_isar_feature(aa64_lor, cpu)) {
-        valid_mask |= SCR_TLOR;
-    }
-    if (cpu_isar_feature(aa64_pauth, cpu)) {
-        valid_mask |= SCR_API | SCR_APK;
-    }
 
     /* Clear all-context RES0 bits.  */
     value &= valid_mask;
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

This does not attempt to rectify all of the res0 bits, but does
clear the mte bits when not enabled.  Since there is no high-part
mapping of SCTLR, aa32 mode cannot write to these bits.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-4-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper.c | 23 +++++++++++++++++------
 1 file changed, 17 insertions(+), 6 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void sctlr_write(CPUARMState *env, const ARMCPRegInfo *ri,
 {
     ARMCPU *cpu = env_archcpu(env);
 
+    if (arm_feature(env, ARM_FEATURE_PMSA) && !cpu->has_mpu) {
+        /* M bit is RAZ/WI for PMSA with no MPU implemented */
+        value &= ~SCTLR_M;
+    }
+
+    /* ??? Lots of these bits are not implemented.  */
+
+    if (ri->state == ARM_CP_STATE_AA64 && !cpu_isar_feature(aa64_mte, cpu)) {
+        if (ri->opc1 == 6) { /* SCTLR_EL3 */
+            value &= ~(SCTLR_ITFSB | SCTLR_TCF | SCTLR_ATA);
+        } else {
+            value &= ~(SCTLR_ITFSB | SCTLR_TCF0 | SCTLR_TCF |
+                       SCTLR_ATA0 | SCTLR_ATA);
+        }
+    }
+
     if (raw_read(env, ri) == value) {
         /* Skip the TLB flush if nothing actually changed; Linux likes
          * to do a lot of pointless SCTLR writes.
@@ -XXX,XX +XXX,XX @@ static void sctlr_write(CPUARMState *env, const ARMCPRegInfo *ri,
         return;
     }
 
-    if (arm_feature(env, ARM_FEATURE_PMSA) && !cpu->has_mpu) {
-        /* M bit is RAZ/WI for PMSA with no MPU implemented */
-        value &= ~SCTLR_M;
-    }
-
     raw_write(env, ri, value);
-    /* ??? Lots of these bits are not implemented.  */
+
     /* This may enable/disable the MMU, so do a TLB flush.  */
     tlb_flush(CPU(cpu));
 
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-5-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper.c | 14 +++++++++++---
 1 file changed, 11 insertions(+), 3 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void scr_write(CPUARMState *env, const ARMCPRegInfo *ri, uint64_t value)
         if (cpu_isar_feature(aa64_pauth, cpu)) {
             valid_mask |= SCR_API | SCR_APK;
         }
+        if (cpu_isar_feature(aa64_mte, cpu)) {
+            valid_mask |= SCR_ATA;
+        }
     } else {
         valid_mask &= ~(SCR_RW | SCR_ST);
     }
@@ -XXX,XX +XXX,XX @@ static void do_hcr_write(CPUARMState *env, uint64_t value, uint64_t valid_mask)
         if (cpu_isar_feature(aa64_pauth, cpu)) {
             valid_mask |= HCR_API | HCR_APK;
         }
+        if (cpu_isar_feature(aa64_mte, cpu)) {
+            valid_mask |= HCR_ATA | HCR_DCT | HCR_TID5;
+        }
     }
 
     /* Clear RES0 bits.  */
     value &= valid_mask;
 
-    /* These bits change the MMU setup:
+    /*
+     * These bits change the MMU setup:
      * HCR_VM enables stage 2 translation
      * HCR_PTW forbids certain page-table setups
-     * HCR_DC Disables stage1 and enables stage2 translation
+     * HCR_DC disables stage1 and enables stage2 translation
+     * HCR_DCT enables tagging on (disabled) stage1 translation
      */
-    if ((env->cp15.hcr_el2 ^ value) & (HCR_VM | HCR_PTW | HCR_DC)) {
+    if ((env->cp15.hcr_el2 ^ value) & (HCR_VM | HCR_PTW | HCR_DC | HCR_DCT)) {
         tlb_flush(CPU(cpu));
     }
     env->cp15.hcr_el2 = value;
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Emphasize that the is_jmp option exits to the main loop.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-6-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.h         | 14 ++++++++------
 target/arm/translate-a64.c     |  8 ++++----
 target/arm/translate-vfp.inc.c |  4 ++--
 target/arm/translate.c         | 12 ++++++------
 4 files changed, 20 insertions(+), 18 deletions(-)

diff --git a/target/arm/translate.h b/target/arm/translate.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.h
+++ b/target/arm/translate.h
@@ -XXX,XX +XXX,XX @@ static inline void disas_set_insn_syndrome(DisasContext *s, uint32_t syn)
 
 /* is_jmp field values */
 #define DISAS_JUMP      DISAS_TARGET_0 /* only pc was modified dynamically */
-#define DISAS_UPDATE    DISAS_TARGET_1 /* cpu state was modified dynamically */
+/* CPU state was modified dynamically; exit to main loop for interrupts. */
+#define DISAS_UPDATE_EXIT  DISAS_TARGET_1
 /* These instructions trap after executing, so the A32/T32 decoder must
  * defer them until after the conditional execution state has been updated.
  * WFI also needs special handling when single-stepping.
@@ -XXX,XX +XXX,XX @@ static inline void disas_set_insn_syndrome(DisasContext *s, uint32_t syn)
  * custom end-of-TB code)
  */
 #define DISAS_BX_EXCRET DISAS_TARGET_8
-/* For instructions which want an immediate exit to the main loop,
- * as opposed to attempting to use lookup_and_goto_ptr. Unlike
- * DISAS_UPDATE this doesn't write the PC on exiting the translation
- * loop so you need to ensure something (gen_a64_set_pc_im or runtime
- * helper) has done so before we reach return from cpu_tb_exec.
+/*
+ * For instructions which want an immediate exit to the main loop, as opposed
+ * to attempting to use lookup_and_goto_ptr.  Unlike DISAS_UPDATE_EXIT, this
+ * doesn't write the PC on exiting the translation loop so you need to ensure
+ * something (gen_a64_set_pc_im or runtime helper) has done so before we reach
+ * return from cpu_tb_exec.
  */
 #define DISAS_EXIT      DISAS_TARGET_9
 
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void handle_msr_i(DisasContext *s, uint32_t insn,
         gen_helper_msr_i_daifclear(cpu_env, t1);
         tcg_temp_free_i32(t1);
         /* For DAIFClear, exit the cpu loop to re-evaluate pending IRQs.  */
-        s->base.is_jmp = DISAS_UPDATE;
+        s->base.is_jmp = DISAS_UPDATE_EXIT;
         break;
 
     default:
@@ -XXX,XX +XXX,XX @@ static void handle_sys(DisasContext *s, uint32_t insn, bool isread,
 
     if ((tb_cflags(s->base.tb) & CF_USE_ICOUNT) && (ri->type & ARM_CP_IO)) {
         /* I/O operations must end the TB here (whether read or write) */
-        s->base.is_jmp = DISAS_UPDATE;
+        s->base.is_jmp = DISAS_UPDATE_EXIT;
     }
     if (!isread && !(ri->type & ARM_CP_SUPPRESS_TB_END)) {
         /*
@@ -XXX,XX +XXX,XX @@ static void handle_sys(DisasContext *s, uint32_t insn, bool isread,
          * but allow this to be suppressed by the register definition
          * (usually only necessary to work around guest bugs).
          */
-        s->base.is_jmp = DISAS_UPDATE;
+        s->base.is_jmp = DISAS_UPDATE_EXIT;
     }
 }
 
@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_tb_stop(DisasContextBase *dcbase, CPUState *cpu)
             gen_goto_tb(dc, 1, dc->base.pc_next);
             break;
         default:
-        case DISAS_UPDATE:
+        case DISAS_UPDATE_EXIT:
             gen_a64_set_pc_im(dc->base.pc_next);
             /* fall through */
         case DISAS_EXIT:
diff --git a/target/arm/translate-vfp.inc.c b/target/arm/translate-vfp.inc.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-vfp.inc.c
+++ b/target/arm/translate-vfp.inc.c
@@ -XXX,XX +XXX,XX @@ static bool full_vfp_access_check(DisasContext *s, bool ignore_vfp_enabled)
              * this to be the last insn in the TB).
              */
             if (tb_cflags(s->base.tb) & CF_USE_ICOUNT) {
-                s->base.is_jmp = DISAS_UPDATE;
+                s->base.is_jmp = DISAS_UPDATE_EXIT;
                 gen_io_start();
             }
             gen_helper_v7m_preserve_fp_state(cpu_env);
@@ -XXX,XX +XXX,XX @@ static bool trans_VLLDM_VLSTM(DisasContext *s, arg_VLLDM_VLSTM *a)
     tcg_temp_free_i32(fptr);
 
     /* End the TB, because we have updated FP control bits */
-    s->base.is_jmp = DISAS_UPDATE;
+    s->base.is_jmp = DISAS_UPDATE_EXIT;
     return true;
 }
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void gen_msr_banked(DisasContext *s, int r, int sysm, int rn)
     tcg_temp_free_i32(tcg_tgtmode);
     tcg_temp_free_i32(tcg_regno);
     tcg_temp_free_i32(tcg_reg);
-    s->base.is_jmp = DISAS_UPDATE;
+    s->base.is_jmp = DISAS_UPDATE_EXIT;
 }
 
 static void gen_mrs_banked(DisasContext *s, int r, int sysm, int rn)
@@ -XXX,XX +XXX,XX @@ static void gen_mrs_banked(DisasContext *s, int r, int sysm, int rn)
     tcg_temp_free_i32(tcg_tgtmode);
     tcg_temp_free_i32(tcg_regno);
     store_reg(s, rn, tcg_reg);
-    s->base.is_jmp = DISAS_UPDATE;
+    s->base.is_jmp = DISAS_UPDATE_EXIT;
 }
 
 /* Store value to PC as for an exception return (ie don't
@@ -XXX,XX +XXX,XX @@ static void gen_srs(DisasContext *s,
         tcg_temp_free_i32(tmp);
     }
     tcg_temp_free_i32(addr);
-    s->base.is_jmp = DISAS_UPDATE;
+    s->base.is_jmp = DISAS_UPDATE_EXIT;
 }
 
 /* Generate a label used for skipping this instruction */
@@ -XXX,XX +XXX,XX @@ static bool trans_SETEND(DisasContext *s, arg_SETEND *a)
     }
     if (a->E != (s->be_data == MO_BE)) {
         gen_helper_setend(cpu_env);
-        s->base.is_jmp = DISAS_UPDATE;
+        s->base.is_jmp = DISAS_UPDATE_EXIT;
     }
     return true;
 }
@@ -XXX,XX +XXX,XX @@ static void arm_tr_tb_stop(DisasContextBase *dcbase, CPUState *cpu)
             break;
         case DISAS_NEXT:
         case DISAS_TOO_MANY:
-        case DISAS_UPDATE:
+        case DISAS_UPDATE_EXIT:
             gen_set_pc_im(dc, dc->base.pc_next);
             /* fall through */
         default:
@@ -XXX,XX +XXX,XX @@ static void arm_tr_tb_stop(DisasContextBase *dcbase, CPUState *cpu)
         case DISAS_JUMP:
             gen_goto_ptr();
             break;
-        case DISAS_UPDATE:
+        case DISAS_UPDATE_EXIT:
             gen_set_pc_im(dc, dc->base.pc_next);
             /* fall through */
         default:
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Add an option that writes back the PC, like DISAS_UPDATE_EXIT,
but does not exit back to the main loop.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-7-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate.h     | 2 ++
 target/arm/translate-a64.c | 3 +++
 target/arm/translate.c     | 4 ++++
 3 files changed, 9 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

This is TFSRE0_EL1, TFSR_EL1, TFSR_EL2, TFSR_EL3,
RGSR_EL1, GCR_EL1, GMID_EL1, and PSTATE.TCO.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-8-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h           |  4 ++
 target/arm/internals.h     |  9 ++++
 target/arm/helper.c        | 94 ++++++++++++++++++++++++++++++++++++++
 target/arm/translate-a64.c | 21 +++++++++
 4 files changed, 128 insertions(+)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ typedef struct CPUARMState {
         uint64_t pmccfiltr_el0; /* Performance Monitor Filter Register */
         uint64_t vpidr_el2; /* Virtualization Processor ID Register */
         uint64_t vmpidr_el2; /* Virtualization Multiprocessor ID Register */
+        uint64_t tfsr_el[4]; /* tfsre0_el1 is index 0.  */
+        uint64_t gcr_el1;
+        uint64_t rgsr_el1;
     } cp15;
 
     struct {
@@ -XXX,XX +XXX,XX @@ void pmu_init(ARMCPU *cpu);
 #define PSTATE_SS (1U << 21)
 #define PSTATE_PAN (1U << 22)
 #define PSTATE_UAO (1U << 23)
+#define PSTATE_TCO (1U << 25)
 #define PSTATE_V (1U << 28)
 #define PSTATE_C (1U << 29)
 #define PSTATE_Z (1U << 30)
diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ static inline uint32_t aarch64_pstate_valid_mask(const ARMISARegisters *id)
     if (isar_feature_aa64_uao(id)) {
         valid |= PSTATE_UAO;
     }
+    if (isar_feature_aa64_mte(id)) {
+        valid |= PSTATE_TCO;
+    }
 
     return valid;
 }
@@ -XXX,XX +XXX,XX @@ void arm_log_exception(int idx);
 
 #endif /* !CONFIG_USER_ONLY */
 
+/*
+ * The log2 of the words in the tag block, for GMID_EL1.BS.
+ * The is the maximum, 256 bytes, which manipulates 64-bits of tags.
+ */
+#define GMID_EL1_BS  6
+
 #endif
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void define_arm_vh_e2h_redirects_aliases(ARMCPU *cpu)
         { K(3, 0,  1, 2, 0), K(3, 4,  1, 2, 0), K(3, 5, 1, 2, 0),
           "ZCR_EL1", "ZCR_EL2", "ZCR_EL12", isar_feature_aa64_sve },
 
+        { K(3, 0,  5, 6, 0), K(3, 4,  5, 6, 0), K(3, 5, 5, 6, 0),
+          "TFSR_EL1", "TFSR_EL2", "TFSR_EL12", isar_feature_aa64_mte },
+
         /* TODO: ARMv8.2-SPE -- PMSCR_EL2 */
         /* TODO: ARMv8.4-Trace -- TRFCR_EL2 */
     };
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo dcpodp_reg[] = {
 };
 #endif /*CONFIG_USER_ONLY*/
 
+static CPAccessResult access_aa64_tid5(CPUARMState *env, const ARMCPRegInfo *ri,
+                                       bool isread)
+{
+    if ((arm_current_el(env) < 2) && (arm_hcr_el2_eff(env) & HCR_TID5)) {
+        return CP_ACCESS_TRAP_EL2;
+    }
+
+    return CP_ACCESS_OK;
+}
+
+static CPAccessResult access_mte(CPUARMState *env, const ARMCPRegInfo *ri,
+                                 bool isread)
+{
+    int el = arm_current_el(env);
+
+    if (el < 2 &&
+        arm_feature(env, ARM_FEATURE_EL2) &&
+        !(arm_hcr_el2_eff(env) & HCR_ATA)) {
+        return CP_ACCESS_TRAP_EL2;
+    }
+    if (el < 3 &&
+        arm_feature(env, ARM_FEATURE_EL3) &&
+        !(env->cp15.scr_el3 & SCR_ATA)) {
+        return CP_ACCESS_TRAP_EL3;
+    }
+    return CP_ACCESS_OK;
+}
+
+static uint64_t tco_read(CPUARMState *env, const ARMCPRegInfo *ri)
+{
+    return env->pstate & PSTATE_TCO;
+}
+
+static void tco_write(CPUARMState *env, const ARMCPRegInfo *ri, uint64_t val)
+{
+    env->pstate = (env->pstate & ~PSTATE_TCO) | (val & PSTATE_TCO);
+}
+
+static const ARMCPRegInfo mte_reginfo[] = {
+    { .name = "TFSRE0_EL1", .state = ARM_CP_STATE_AA64,
+      .opc0 = 3, .opc1 = 0, .crn = 5, .crm = 6, .opc2 = 1,
+      .access = PL1_RW, .accessfn = access_mte,
+      .fieldoffset = offsetof(CPUARMState, cp15.tfsr_el[0]) },
+    { .name = "TFSR_EL1", .state = ARM_CP_STATE_AA64,
+      .opc0 = 3, .opc1 = 0, .crn = 5, .crm = 6, .opc2 = 0,
+      .access = PL1_RW, .accessfn = access_mte,
+      .fieldoffset = offsetof(CPUARMState, cp15.tfsr_el[1]) },
+    { .name = "TFSR_EL2", .state = ARM_CP_STATE_AA64,
+      .opc0 = 3, .opc1 = 4, .crn = 5, .crm = 6, .opc2 = 0,
+      .access = PL2_RW, .accessfn = access_mte,
+      .fieldoffset = offsetof(CPUARMState, cp15.tfsr_el[2]) },
+    { .name = "TFSR_EL3", .state = ARM_CP_STATE_AA64,
+      .opc0 = 3, .opc1 = 6, .crn = 5, .crm = 6, .opc2 = 0,
+      .access = PL3_RW,
+      .fieldoffset = offsetof(CPUARMState, cp15.tfsr_el[3]) },
+    { .name = "RGSR_EL1", .state = ARM_CP_STATE_AA64,
+      .opc0 = 3, .opc1 = 0, .crn = 1, .crm = 0, .opc2 = 5,
+      .access = PL1_RW, .accessfn = access_mte,
+      .fieldoffset = offsetof(CPUARMState, cp15.rgsr_el1) },
+    { .name = "GCR_EL1", .state = ARM_CP_STATE_AA64,
+      .opc0 = 3, .opc1 = 0, .crn = 1, .crm = 0, .opc2 = 6,
+      .access = PL1_RW, .accessfn = access_mte,
+      .fieldoffset = offsetof(CPUARMState, cp15.gcr_el1) },
+    { .name = "GMID_EL1", .state = ARM_CP_STATE_AA64,
+      .opc0 = 3, .opc1 = 1, .crn = 0, .crm = 0, .opc2 = 4,
+      .access = PL1_R, .accessfn = access_aa64_tid5,
+      .type = ARM_CP_CONST, .resetvalue = GMID_EL1_BS },
+    { .name = "TCO", .state = ARM_CP_STATE_AA64,
+      .opc0 = 3, .opc1 = 3, .crn = 4, .crm = 2, .opc2 = 7,
+      .type = ARM_CP_NO_RAW,
+      .access = PL0_RW, .readfn = tco_read, .writefn = tco_write },
+    REGINFO_SENTINEL
+};
+
+static const ARMCPRegInfo mte_tco_ro_reginfo[] = {
+    { .name = "TCO", .state = ARM_CP_STATE_AA64,
+      .opc0 = 3, .opc1 = 3, .crn = 4, .crm = 2, .opc2 = 7,
+      .type = ARM_CP_CONST, .access = PL0_RW, },
+    REGINFO_SENTINEL
+};
 #endif
 
 static CPAccessResult access_predinv(CPUARMState *env, const ARMCPRegInfo *ri,
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
         }
     }
 #endif /*CONFIG_USER_ONLY*/
+
+    /*
+     * If full MTE is enabled, add all of the system registers.
+     * If only "instructions available at EL0" are enabled,
+     * then define only a RAZ/WI version of PSTATE.TCO.
+     */
+    if (cpu_isar_feature(aa64_mte, cpu)) {
+        define_arm_cp_regs(cpu, mte_reginfo);
+    } else if (cpu_isar_feature(aa64_mte_insn_reg, cpu)) {
+        define_arm_cp_regs(cpu, mte_tco_ro_reginfo);
+    }
 #endif
 
     if (cpu_isar_feature(any_predinv, cpu)) {
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void handle_msr_i(DisasContext *s, uint32_t insn,
         s->base.is_jmp = DISAS_UPDATE_EXIT;
         break;
 
+    case 0x1c: /* TCO */
+        if (dc_isar_feature(aa64_mte, s)) {
+            /* Full MTE is enabled -- set the TCO bit as directed. */
+            if (crm & 1) {
+                set_pstate_bits(PSTATE_TCO);
+            } else {
+                clear_pstate_bits(PSTATE_TCO);
+            }
+            t1 = tcg_const_i32(s->current_el);
+            gen_helper_rebuild_hflags_a64(cpu_env, t1);
+            tcg_temp_free_i32(t1);
+            /* Many factors, including TCO, go into MTE_ACTIVE. */
+            s->base.is_jmp = DISAS_UPDATE_NOCHAIN;
+        } else if (dc_isar_feature(aa64_mte_insn_reg, s)) {
+            /* Only "instructions accessible at EL0" -- PSTATE.TCO is WI.  */
+            s->base.is_jmp = DISAS_NEXT;
+        } else {
+            goto do_unallocated;
+        }
+        break;
+
     default:
     do_unallocated:
         unallocated_encoding(s);
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Cache the composite ATA setting.

Cache when MTE is fully enabled, i.e. access to tags are enabled
and tag checks affect the PE.  Do this for both the normal context
and the UNPRIV context.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-9-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h           | 12 ++++++++----
 target/arm/internals.h     | 18 +++++++++++++++++
 target/arm/translate.h     |  5 +++++
 target/arm/helper.c        | 40 ++++++++++++++++++++++++++++++++++++++
 target/arm/translate-a64.c |  4 ++++
 5 files changed, 75 insertions(+), 4 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ typedef ARMCPU ArchCPU;
  * |              |     |   TBFLAG_A32   |              |
  * |              |     +-----+----------+  TBFLAG_AM32 |
  * |  TBFLAG_ANY  |           |TBFLAG_M32|              |
- * |              |         +-+----------+--------------|
- * |              |         |         TBFLAG_A64        |
- * +--------------+---------+---------------------------+
- *  31          20        15                           0
+ * |              +-----------+----------+--------------|
+ * |              |            TBFLAG_A64               |
+ * +--------------+-------------------------------------+
+ *  31          20                                     0
  *
  * Unless otherwise noted, these bits are cached in env->hflags.
  */
@@ -XXX,XX +XXX,XX @@ FIELD(TBFLAG_A64, BT, 9, 1)
 FIELD(TBFLAG_A64, BTYPE, 10, 2)         /* Not cached. */
 FIELD(TBFLAG_A64, TBID, 12, 2)
 FIELD(TBFLAG_A64, UNPRIV, 14, 1)
+FIELD(TBFLAG_A64, ATA, 15, 1)
+FIELD(TBFLAG_A64, TCMA, 16, 2)
+FIELD(TBFLAG_A64, MTE_ACTIVE, 18, 1)
+FIELD(TBFLAG_A64, MTE0_ACTIVE, 19, 1)
 
 /**
  * cpu_mmu_index:
diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ static inline int exception_target_el(CPUARMState *env)
     return target_el;
 }
 
+/* Determine if allocation tags are available.  */
+static inline bool allocation_tag_access_enabled(CPUARMState *env, int el,
+                                                 uint64_t sctlr)
+{
+    if (el < 3
+        && arm_feature(env, ARM_FEATURE_EL3)
+        && !(env->cp15.scr_el3 & SCR_ATA)) {
+        return false;
+    }
+    if (el < 2
+        && arm_feature(env, ARM_FEATURE_EL2)
+        && !(arm_hcr_el2_eff(env) & HCR_ATA)) {
+        return false;
+    }
+    sctlr &= (el == 0 ? SCTLR_ATA0 : SCTLR_ATA);
+    return sctlr != 0;
+}
+
 #ifndef CONFIG_USER_ONLY
 
 /* Security attributes for an address, as returned by v8m_security_lookup. */
diff --git a/target/arm/translate.h b/target/arm/translate.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.h
+++ b/target/arm/translate.h
@@ -XXX,XX +XXX,XX @@ typedef struct DisasContext {
     ARMMMUIdx mmu_idx; /* MMU index to use for normal loads/stores */
     uint8_t tbii;      /* TBI1|TBI0 for insns */
     uint8_t tbid;      /* TBI1|TBI0 for data */
+    uint8_t tcma;      /* TCMA1|TCMA0 for MTE */
     bool ns;        /* Use non-secure CPREG bank on access */
     int fp_excp_el; /* FP exception EL or 0 if enabled */
     int sve_excp_el; /* SVE exception EL or 0 if enabled */
@@ -XXX,XX +XXX,XX @@ typedef struct DisasContext {
     bool unpriv;
     /* True if v8.3-PAuth is active.  */
     bool pauth_active;
+    /* True if v8.5-MTE access to tags is enabled.  */
+    bool ata;
+    /* True if v8.5-MTE tag checks affect the PE; index with is_unpriv.  */
+    bool mte_active[2];
     /* True with v8.5-BTI and SCTLR_ELx.BT* set.  */
     bool bt;
     /* True if any CP15 access is trapped by HSTR_EL2 */
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static int aa64_va_parameter_tbid(uint64_t tcr, ARMMMUIdx mmu_idx)
     }
 }
 
+static int aa64_va_parameter_tcma(uint64_t tcr, ARMMMUIdx mmu_idx)
+{
+    if (regime_has_2_ranges(mmu_idx)) {
+        return extract64(tcr, 57, 2);
+    } else {
+        /* Replicate the single TCMA bit so we always have 2 bits.  */
+        return extract32(tcr, 30, 1) * 3;
+    }
+}
+
 ARMVAParameters aa64_va_parameters(CPUARMState *env, uint64_t va,
                                    ARMMMUIdx mmu_idx, bool data)
 {
@@ -XXX,XX +XXX,XX @@ static uint32_t rebuild_hflags_a64(CPUARMState *env, int el, int fp_el,
         }
     }
 
+    if (cpu_isar_feature(aa64_mte, env_archcpu(env))) {
+        /*
+         * Set MTE_ACTIVE if any access may be Checked, and leave clear
+         * if all accesses must be Unchecked:
+         * 1) If no TBI, then there are no tags in the address to check,
+         * 2) If Tag Check Override, then all accesses are Unchecked,
+         * 3) If Tag Check Fail == 0, then Checked access have no effect,
+         * 4) If no Allocation Tag Access, then all accesses are Unchecked.
+         */
+        if (allocation_tag_access_enabled(env, el, sctlr)) {
+            flags = FIELD_DP32(flags, TBFLAG_A64, ATA, 1);
+            if (tbid
+                && !(env->pstate & PSTATE_TCO)
+                && (sctlr & (el == 0 ? SCTLR_TCF0 : SCTLR_TCF))) {
+                flags = FIELD_DP32(flags, TBFLAG_A64, MTE_ACTIVE, 1);
+            }
+        }
+        /* And again for unprivileged accesses, if required.  */
+        if (FIELD_EX32(flags, TBFLAG_A64, UNPRIV)
+            && tbid
+            && !(env->pstate & PSTATE_TCO)
+            && (sctlr & SCTLR_TCF0)
+            && allocation_tag_access_enabled(env, 0, sctlr)) {
+            flags = FIELD_DP32(flags, TBFLAG_A64, MTE0_ACTIVE, 1);
+        }
+        /* Cache TCMA as well as TBI. */
+        flags = FIELD_DP32(flags, TBFLAG_A64, TCMA,
+                           aa64_va_parameter_tcma(tcr, mmu_idx));
+    }
+
     return rebuild_hflags_common(env, fp_el, mmu_idx, flags);
 }
 
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_init_disas_context(DisasContextBase *dcbase,
     dc->mmu_idx = core_to_aa64_mmu_idx(core_mmu_idx);
     dc->tbii = FIELD_EX32(tb_flags, TBFLAG_A64, TBII);
     dc->tbid = FIELD_EX32(tb_flags, TBFLAG_A64, TBID);
+    dc->tcma = FIELD_EX32(tb_flags, TBFLAG_A64, TCMA);
     dc->current_el = arm_mmu_idx_to_el(dc->mmu_idx);
 #if !defined(CONFIG_USER_ONLY)
     dc->user = (dc->current_el == 0);
@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_init_disas_context(DisasContextBase *dcbase,
     dc->bt = FIELD_EX32(tb_flags, TBFLAG_A64, BT);
     dc->btype = FIELD_EX32(tb_flags, TBFLAG_A64, BTYPE);
     dc->unpriv = FIELD_EX32(tb_flags, TBFLAG_A64, UNPRIV);
+    dc->ata = FIELD_EX32(tb_flags, TBFLAG_A64, ATA);
+    dc->mte_active[0] = FIELD_EX32(tb_flags, TBFLAG_A64, MTE_ACTIVE);
+    dc->mte_active[1] = FIELD_EX32(tb_flags, TBFLAG_A64, MTE0_ACTIVE);
     dc->vec_len = 0;
     dc->vec_stride = 0;
     dc->cp_regs = arm_cpu->cp_regs;
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-10-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-a64.h    |  2 ++
 target/arm/internals.h     |  5 +++
 target/arm/mte_helper.c    | 72 ++++++++++++++++++++++++++++++++++++++
 target/arm/translate-a64.c | 18 ++++++++++
 target/arm/Makefile.objs   |  1 +
 5 files changed, 98 insertions(+)
 create mode 100644 target/arm/mte_helper.c

From: Richard Henderson <richard.henderson@linaro.org>

The current Arm ARM has adjusted the official decode of
"Add/subtract (immediate)" so that the shift field is only bit 22,
and bit 23 is part of the op1 field of the parent category
"Data processing - immediate".

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-11-richard.henderson@linaro.org
Suggested-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 23 ++++++++---------------
 1 file changed, 8 insertions(+), 15 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_pc_rel_adr(DisasContext *s, uint32_t insn)
 /*
  * Add/subtract (immediate)
  *
- *  31 30 29 28       24 23 22 21         10 9   5 4   0
- * +--+--+--+-----------+-----+-------------+-----+-----+
- * |sf|op| S| 1 0 0 0 1 |shift|    imm12    |  Rn | Rd  |
- * +--+--+--+-----------+-----+-------------+-----+-----+
+ *  31 30 29 28         23 22 21         10 9   5 4   0
+ * +--+--+--+-------------+--+-------------+-----+-----+
+ * |sf|op| S| 1 0 0 0 1 0 |sh|    imm12    |  Rn | Rd  |
+ * +--+--+--+-------------+--+-------------+-----+-----+
  *
  *    sf: 0 -> 32bit, 1 -> 64bit
  *    op: 0 -> add  , 1 -> sub
  *     S: 1 -> set flags
- * shift: 00 -> LSL imm by 0, 01 -> LSL imm by 12
+ *    sh: 1 -> LSL imm by 12
  */
 static void disas_add_sub_imm(DisasContext *s, uint32_t insn)
 {
     int rd = extract32(insn, 0, 5);
     int rn = extract32(insn, 5, 5);
     uint64_t imm = extract32(insn, 10, 12);
-    int shift = extract32(insn, 22, 2);
+    bool shift = extract32(insn, 22, 1);
     bool setflags = extract32(insn, 29, 1);
     bool sub_op = extract32(insn, 30, 1);
     bool is_64bit = extract32(insn, 31, 1);
@@ -XXX,XX +XXX,XX @@ static void disas_add_sub_imm(DisasContext *s, uint32_t insn)
     TCGv_i64 tcg_rd = setflags ? cpu_reg(s, rd) : cpu_reg_sp(s, rd);
     TCGv_i64 tcg_result;
 
-    switch (shift) {
-    case 0x0:
-        break;
-    case 0x1:
+    if (shift) {
         imm <<= 12;
-        break;
-    default:
-        unallocated_encoding(s);
-        return;
     }
 
     tcg_result = tcg_temp_new_i64();
@@ -XXX,XX +XXX,XX @@ static void disas_data_proc_imm(DisasContext *s, uint32_t insn)
     case 0x20: case 0x21: /* PC-rel. addressing */
         disas_pc_rel_adr(s, insn);
         break;
-    case 0x22: case 0x23: /* Add/subtract (immediate) */
+    case 0x22: /* Add/subtract (immediate) */
         disas_add_sub_imm(s, insn);
         break;
     case 0x24: /* Logical (immediate) */
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-12-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-a64.h    |  1 +
 target/arm/internals.h     |  9 +++++++
 target/arm/mte_helper.c    | 10 ++++++++
 target/arm/translate-a64.c | 51 ++++++++++++++++++++++++++++++++++++++
 4 files changed, 71 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-13-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 15 +++++++++++++++
 1 file changed, 15 insertions(+)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_data_proc_2src(DisasContext *s, uint32_t insn)
                                              cpu_reg_sp(s, rn));
         }
         break;
+    case 5: /* GMI */
+        if (sf == 0 || !dc_isar_feature(aa64_mte_insn_reg, s)) {
+            goto do_unallocated;
+        } else {
+            TCGv_i64 t1 = tcg_const_i64(1);
+            TCGv_i64 t2 = tcg_temp_new_i64();
+
+            tcg_gen_extract_i64(t2, cpu_reg_sp(s, rn), 56, 4);
+            tcg_gen_shl_i64(t1, t1, t2);
+            tcg_gen_or_i64(cpu_reg(s, rd), cpu_reg(s, rm), t1);
+
+            tcg_temp_free_i64(t1);
+            tcg_temp_free_i64(t2);
+        }
+        break;
     case 8: /* LSLV */
         handle_shift_reg(s, A64_SHIFT_TYPE_LSL, sf, rm, rn, rd);
         break;
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-14-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 24 ++++++++++++++++++++++--
 1 file changed, 22 insertions(+), 2 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void handle_crc32(DisasContext *s,
  */
 static void disas_data_proc_2src(DisasContext *s, uint32_t insn)
 {
-    unsigned int sf, rm, opcode, rn, rd;
+    unsigned int sf, rm, opcode, rn, rd, setflag;
     sf = extract32(insn, 31, 1);
+    setflag = extract32(insn, 29, 1);
     rm = extract32(insn, 16, 5);
     opcode = extract32(insn, 10, 6);
     rn = extract32(insn, 5, 5);
     rd = extract32(insn, 0, 5);
 
-    if (extract32(insn, 29, 1)) {
+    if (setflag && opcode != 0) {
         unallocated_encoding(s);
         return;
     }
 
     switch (opcode) {
+    case 0: /* SUBP(S) */
+        if (sf == 0 || !dc_isar_feature(aa64_mte_insn_reg, s)) {
+            goto do_unallocated;
+        } else {
+            TCGv_i64 tcg_n, tcg_m, tcg_d;
+
+            tcg_n = read_cpu_reg_sp(s, rn, true);
+            tcg_m = read_cpu_reg_sp(s, rm, true);
+            tcg_gen_sextract_i64(tcg_n, tcg_n, 0, 56);
+            tcg_gen_sextract_i64(tcg_m, tcg_m, 0, 56);
+            tcg_d = cpu_reg(s, rd);
+
+            if (setflag) {
+                gen_sub_CC(true, tcg_d, tcg_n, tcg_m);
+            } else {
+                tcg_gen_sub_i64(tcg_d, tcg_n, tcg_m);
+            }
+        }
+        break;
     case 2: /* UDIV */
         handle_div(s, false, sf, rm, rn, rd);
         break;
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Use the same code as system mode, so that we generate the same
exception + syndrome for the unaligned access.

For the moment, if MTE is enabled so that this path is reachable,
this would generate a SIGSEGV in the user-only cpu_loop.  Decoding
the syndrome to produce the proper SIGBUS will be done later.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-15-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.c        | 2 +-
 target/arm/tlb_helper.c | 4 ++--
 2 files changed, 3 insertions(+), 3 deletions(-)

diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_class_init(ObjectClass *oc, void *data)
     cc->tlb_fill = arm_cpu_tlb_fill;
     cc->debug_excp_handler = arm_debug_excp_handler;
     cc->debug_check_watchpoint = arm_debug_check_watchpoint;
-#if !defined(CONFIG_USER_ONLY)
     cc->do_unaligned_access = arm_cpu_do_unaligned_access;
+#if !defined(CONFIG_USER_ONLY)
     cc->do_transaction_failed = arm_cpu_do_transaction_failed;
     cc->adjust_watchpoint_address = arm_adjust_watchpoint_address;
 #endif /* CONFIG_TCG && !CONFIG_USER_ONLY */
diff --git a/target/arm/tlb_helper.c b/target/arm/tlb_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/tlb_helper.c
+++ b/target/arm/tlb_helper.c
@@ -XXX,XX +XXX,XX @@
 #include "internals.h"
 #include "exec/exec-all.h"
 
-#if !defined(CONFIG_USER_ONLY)
-
 static inline uint32_t merge_syn_data_abort(uint32_t template_syn,
                                             unsigned int target_el,
                                             bool same_el, bool ea,
@@ -XXX,XX +XXX,XX @@ void arm_cpu_do_unaligned_access(CPUState *cs, vaddr vaddr,
     arm_deliver_fault(cpu, vaddr, access_type, mmu_idx, &fi);
 }
 
+#if !defined(CONFIG_USER_ONLY)
+
 /*
  * arm_cpu_do_transaction_failed: handle a memory system error response
  * (eg "no device/memory present at address") by raising an external abort
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-16-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-a64.h    |   7 ++
 target/arm/helper.h        |   2 +
 target/arm/mte_helper.c    | 194 +++++++++++++++++++++++++++++++++++++
 target/arm/op_helper.c     |  16 +++
 target/arm/translate-a64.c | 172 +++++++++++++++++++++++++++++++-
 5 files changed, 386 insertions(+), 5 deletions(-)

diff --git a/target/arm/helper-a64.h b/target/arm/helper-a64.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper-a64.h
+++ b/target/arm/helper-a64.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_2(xpacd, TCG_CALL_NO_RWG_SE, i64, env, i64)
 
 DEF_HELPER_FLAGS_3(irg, TCG_CALL_NO_RWG, i64, env, i64, i64)
 DEF_HELPER_FLAGS_4(addsubg, TCG_CALL_NO_RWG_SE, i64, env, i64, s32, i32)
+DEF_HELPER_FLAGS_3(ldg, TCG_CALL_NO_WG, i64, env, i64, i64)
+DEF_HELPER_FLAGS_3(stg, TCG_CALL_NO_WG, void, env, i64, i64)
+DEF_HELPER_FLAGS_3(stg_parallel, TCG_CALL_NO_WG, void, env, i64, i64)
+DEF_HELPER_FLAGS_2(stg_stub, TCG_CALL_NO_WG, void, env, i64)
+DEF_HELPER_FLAGS_3(st2g, TCG_CALL_NO_WG, void, env, i64, i64)
+DEF_HELPER_FLAGS_3(st2g_parallel, TCG_CALL_NO_WG, void, env, i64, i64)
+DEF_HELPER_FLAGS_2(st2g_stub, TCG_CALL_NO_WG, void, env, i64)
diff --git a/target/arm/helper.h b/target/arm/helper.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.h
+++ b/target/arm/helper.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_1(rebuild_hflags_a32_newel, TCG_CALL_NO_RWG, void, env)
 DEF_HELPER_FLAGS_2(rebuild_hflags_a32, TCG_CALL_NO_RWG, void, env, int)
 DEF_HELPER_FLAGS_2(rebuild_hflags_a64, TCG_CALL_NO_RWG, void, env, int)
 
+DEF_HELPER_FLAGS_5(probe_access, TCG_CALL_NO_WG, void, env, tl, i32, i32, i32)
+
 DEF_HELPER_1(vfp_get_fpscr, i32, env)
 DEF_HELPER_2(vfp_set_fpscr, void, env, i32)
 
diff --git a/target/arm/mte_helper.c b/target/arm/mte_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/mte_helper.c
+++ b/target/arm/mte_helper.c
@@ -XXX,XX +XXX,XX @@ static int choose_nonexcluded_tag(int tag, int offset, uint16_t exclude)
     return tag;
 }
 
+/**
+ * allocation_tag_mem:
+ * @env: the cpu environment
+ * @ptr_mmu_idx: the addressing regime to use for the virtual address
+ * @ptr: the virtual address for which to look up tag memory
+ * @ptr_access: the access to use for the virtual address
+ * @ptr_size: the number of bytes in the normal memory access
+ * @tag_access: the access to use for the tag memory
+ * @tag_size: the number of bytes in the tag memory access
+ * @ra: the return address for exception handling
+ *
+ * Our tag memory is formatted as a sequence of little-endian nibbles.
+ * That is, the byte at (addr >> (LOG2_TAG_GRANULE + 1)) contains two
+ * tags, with the tag at [3:0] for the lower addr and the tag at [7:4]
+ * for the higher addr.
+ *
+ * Here, resolve the physical address from the virtual address, and return
+ * a pointer to the corresponding tag byte.  Exit with exception if the
+ * virtual address is not accessible for @ptr_access.
+ *
+ * The @ptr_size and @tag_size values may not have an obvious relation
+ * due to the alignment of @ptr, and the number of tag checks required.
+ *
+ * If there is no tag storage corresponding to @ptr, return NULL.
+ */
+static uint8_t *allocation_tag_mem(CPUARMState *env, int ptr_mmu_idx,
+                                   uint64_t ptr, MMUAccessType ptr_access,
+                                   int ptr_size, MMUAccessType tag_access,
+                                   int tag_size, uintptr_t ra)
+{
+    /* Tag storage not implemented.  */
+    return NULL;
+}
+
 uint64_t HELPER(irg)(CPUARMState *env, uint64_t rn, uint64_t rm)
 {
     int rtag;
@@ -XXX,XX +XXX,XX @@ uint64_t HELPER(addsubg)(CPUARMState *env, uint64_t ptr,
 
     return address_with_allocation_tag(ptr + offset, rtag);
 }
+
+static int load_tag1(uint64_t ptr, uint8_t *mem)
+{
+    int ofs = extract32(ptr, LOG2_TAG_GRANULE, 1) * 4;
+    return extract32(*mem, ofs, 4);
+}
+
+uint64_t HELPER(ldg)(CPUARMState *env, uint64_t ptr, uint64_t xt)
+{
+    int mmu_idx = cpu_mmu_index(env, false);
+    uint8_t *mem;
+    int rtag = 0;
+
+    /* Trap if accessing an invalid page.  */
+    mem = allocation_tag_mem(env, mmu_idx, ptr, MMU_DATA_LOAD, 1,
+                             MMU_DATA_LOAD, 1, GETPC());
+
+    /* Load if page supports tags. */
+    if (mem) {
+        rtag = load_tag1(ptr, mem);
+    }
+
+    return address_with_allocation_tag(xt, rtag);
+}
+
+static void check_tag_aligned(CPUARMState *env, uint64_t ptr, uintptr_t ra)
+{
+    if (unlikely(!QEMU_IS_ALIGNED(ptr, TAG_GRANULE))) {
+        arm_cpu_do_unaligned_access(env_cpu(env), ptr, MMU_DATA_STORE,
+                                    cpu_mmu_index(env, false), ra);
+        g_assert_not_reached();
+    }
+}
+
+/* For use in a non-parallel context, store to the given nibble.  */
+static void store_tag1(uint64_t ptr, uint8_t *mem, int tag)
+{
+    int ofs = extract32(ptr, LOG2_TAG_GRANULE, 1) * 4;
+    *mem = deposit32(*mem, ofs, 4, tag);
+}
+
+/* For use in a parallel context, atomically store to the given nibble.  */
+static void store_tag1_parallel(uint64_t ptr, uint8_t *mem, int tag)
+{
+    int ofs = extract32(ptr, LOG2_TAG_GRANULE, 1) * 4;
+    uint8_t old = atomic_read(mem);
+
+    while (1) {
+        uint8_t new = deposit32(old, ofs, 4, tag);
+        uint8_t cmp = atomic_cmpxchg(mem, old, new);
+        if (likely(cmp == old)) {
+            return;
+        }
+        old = cmp;
+    }
+}
+
+typedef void stg_store1(uint64_t, uint8_t *, int);
+
+static inline void do_stg(CPUARMState *env, uint64_t ptr, uint64_t xt,
+                          uintptr_t ra, stg_store1 store1)
+{
+    int mmu_idx = cpu_mmu_index(env, false);
+    uint8_t *mem;
+
+    check_tag_aligned(env, ptr, ra);
+
+    /* Trap if accessing an invalid page.  */
+    mem = allocation_tag_mem(env, mmu_idx, ptr, MMU_DATA_STORE, TAG_GRANULE,
+                             MMU_DATA_STORE, 1, ra);
+
+    /* Store if page supports tags. */
+    if (mem) {
+        store1(ptr, mem, allocation_tag_from_addr(xt));
+    }
+}
+
+void HELPER(stg)(CPUARMState *env, uint64_t ptr, uint64_t xt)
+{
+    do_stg(env, ptr, xt, GETPC(), store_tag1);
+}
+
+void HELPER(stg_parallel)(CPUARMState *env, uint64_t ptr, uint64_t xt)
+{
+    do_stg(env, ptr, xt, GETPC(), store_tag1_parallel);
+}
+
+void HELPER(stg_stub)(CPUARMState *env, uint64_t ptr)
+{
+    int mmu_idx = cpu_mmu_index(env, false);
+    uintptr_t ra = GETPC();
+
+    check_tag_aligned(env, ptr, ra);
+    probe_write(env, ptr, TAG_GRANULE, mmu_idx, ra);
+}
+
+static inline void do_st2g(CPUARMState *env, uint64_t ptr, uint64_t xt,
+                           uintptr_t ra, stg_store1 store1)
+{
+    int mmu_idx = cpu_mmu_index(env, false);
+    int tag = allocation_tag_from_addr(xt);
+    uint8_t *mem1, *mem2;
+
+    check_tag_aligned(env, ptr, ra);
+
+    /*
+     * Trap if accessing an invalid page(s).
+     * This takes priority over !allocation_tag_access_enabled.
+     */
+    if (ptr & TAG_GRANULE) {
+        /* Two stores unaligned mod TAG_GRANULE*2 -- modify two bytes. */
+        mem1 = allocation_tag_mem(env, mmu_idx, ptr, MMU_DATA_STORE,
+                                  TAG_GRANULE, MMU_DATA_STORE, 1, ra);
+        mem2 = allocation_tag_mem(env, mmu_idx, ptr + TAG_GRANULE,
+                                  MMU_DATA_STORE, TAG_GRANULE,
+                                  MMU_DATA_STORE, 1, ra);
+
+        /* Store if page(s) support tags. */
+        if (mem1) {
+            store1(TAG_GRANULE, mem1, tag);
+        }
+        if (mem2) {
+            store1(0, mem2, tag);
+        }
+    } else {
+        /* Two stores aligned mod TAG_GRANULE*2 -- modify one byte. */
+        mem1 = allocation_tag_mem(env, mmu_idx, ptr, MMU_DATA_STORE,
+                                  2 * TAG_GRANULE, MMU_DATA_STORE, 1, ra);
+        if (mem1) {
+            tag |= tag << 4;
+            atomic_set(mem1, tag);
+        }
+    }
+}
+
+void HELPER(st2g)(CPUARMState *env, uint64_t ptr, uint64_t xt)
+{
+    do_st2g(env, ptr, xt, GETPC(), store_tag1);
+}
+
+void HELPER(st2g_parallel)(CPUARMState *env, uint64_t ptr, uint64_t xt)
+{
+    do_st2g(env, ptr, xt, GETPC(), store_tag1_parallel);
+}
+
+void HELPER(st2g_stub)(CPUARMState *env, uint64_t ptr)
+{
+    int mmu_idx = cpu_mmu_index(env, false);
+    uintptr_t ra = GETPC();
+    int in_page = -(ptr | TARGET_PAGE_MASK);
+
+    check_tag_aligned(env, ptr, ra);
+
+    if (likely(in_page >= 2 * TAG_GRANULE)) {
+        probe_write(env, ptr, 2 * TAG_GRANULE, mmu_idx, ra);
+    } else {
+        probe_write(env, ptr, TAG_GRANULE, mmu_idx, ra);
+        probe_write(env, ptr + TAG_GRANULE, TAG_GRANULE, mmu_idx, ra);
+    }
+}
diff --git a/target/arm/op_helper.c b/target/arm/op_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/op_helper.c
+++ b/target/arm/op_helper.c
@@ -XXX,XX +XXX,XX @@ uint32_t HELPER(ror_cc)(CPUARMState *env, uint32_t x, uint32_t i)
         return ((uint32_t)x >> shift) | (x << (32 - shift));
     }
 }
+
+void HELPER(probe_access)(CPUARMState *env, target_ulong ptr,
+                          uint32_t access_type, uint32_t mmu_idx,
+                          uint32_t size)
+{
+    uint32_t in_page = -((uint32_t)ptr | TARGET_PAGE_SIZE);
+    uintptr_t ra = GETPC();
+
+    if (likely(size <= in_page)) {
+        probe_access(env, ptr, size, access_type, mmu_idx, ra);
+    } else {
+        probe_access(env, ptr, in_page, access_type, mmu_idx, ra);
+        probe_access(env, ptr + in_page, size - in_page,
+                     access_type, mmu_idx, ra);
+    }
+}
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void gen_address_with_allocation_tag0(TCGv_i64 dst, TCGv_i64 src)
     tcg_gen_andi_i64(dst, src, ~MAKE_64BIT_MASK(56, 4));
 }
 
+static void gen_probe_access(DisasContext *s, TCGv_i64 ptr,
+                             MMUAccessType acc, int log2_size)
+{
+    TCGv_i32 t_acc = tcg_const_i32(acc);
+    TCGv_i32 t_idx = tcg_const_i32(get_mem_index(s));
+    TCGv_i32 t_size = tcg_const_i32(1 << log2_size);
+
+    gen_helper_probe_access(cpu_env, ptr, t_acc, t_idx, t_size);
+    tcg_temp_free_i32(t_acc);
+    tcg_temp_free_i32(t_idx);
+    tcg_temp_free_i32(t_size);
+}
+
 typedef struct DisasCompare64 {
     TCGCond cond;
     TCGv_i64 value;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_single_struct(DisasContext *s, uint32_t insn)
     }
 }
 
+/*
+ * Load/Store memory tags
+ *
+ *  31 30 29         24     22  21     12    10      5      0
+ * +-----+-------------+-----+---+------+-----+------+------+
+ * | 1 1 | 0 1 1 0 0 1 | op1 | 1 | imm9 | op2 |  Rn  |  Rt  |
+ * +-----+-------------+-----+---+------+-----+------+------+
+ */
+static void disas_ldst_tag(DisasContext *s, uint32_t insn)
+{
+    int rt = extract32(insn, 0, 5);
+    int rn = extract32(insn, 5, 5);
+    uint64_t offset = sextract64(insn, 12, 9) << LOG2_TAG_GRANULE;
+    int op2 = extract32(insn, 10, 2);
+    int op1 = extract32(insn, 22, 2);
+    bool is_load = false, is_pair = false, is_zero = false;
+    int index = 0;
+    TCGv_i64 addr, clean_addr, tcg_rt;
+
+    /* We checked insn bits [29:24,21] in the caller.  */
+    if (extract32(insn, 30, 2) != 3) {
+        goto do_unallocated;
+    }
+
+    /*
+     * @index is a tri-state variable which has 3 states:
+     * < 0 : post-index, writeback
+     * = 0 : signed offset
+     * > 0 : pre-index, writeback
+     */
+    switch (op1) {
+    case 0:
+        if (op2 != 0) {
+            /* STG */
+            index = op2 - 2;
+            break;
+        }
+        goto do_unallocated;
+    case 1:
+        if (op2 != 0) {
+            /* STZG */
+            is_zero = true;
+            index = op2 - 2;
+        } else {
+            /* LDG */
+            is_load = true;
+        }
+        break;
+    case 2:
+        if (op2 != 0) {
+            /* ST2G */
+            is_pair = true;
+            index = op2 - 2;
+            break;
+        }
+        goto do_unallocated;
+    case 3:
+        if (op2 != 0) {
+            /* STZ2G */
+            is_pair = is_zero = true;
+            index = op2 - 2;
+            break;
+        }
+        goto do_unallocated;
+
+    default:
+    do_unallocated:
+        unallocated_encoding(s);
+        return;
+    }
+
+    if (!dc_isar_feature(aa64_mte_insn_reg, s)) {
+        goto do_unallocated;
+    }
+
+    if (rn == 31) {
+        gen_check_sp_alignment(s);
+    }
+
+    addr = read_cpu_reg_sp(s, rn, true);
+    if (index >= 0) {
+        /* pre-index or signed offset */
+        tcg_gen_addi_i64(addr, addr, offset);
+    }
+
+    if (is_load) {
+        tcg_gen_andi_i64(addr, addr, -TAG_GRANULE);
+        tcg_rt = cpu_reg(s, rt);
+        if (s->ata) {
+            gen_helper_ldg(tcg_rt, cpu_env, addr, tcg_rt);
+        } else {
+            clean_addr = clean_data_tbi(s, addr);
+            gen_probe_access(s, clean_addr, MMU_DATA_LOAD, MO_8);
+            gen_address_with_allocation_tag0(tcg_rt, addr);
+        }
+    } else {
+        tcg_rt = cpu_reg_sp(s, rt);
+        if (!s->ata) {
+            /*
+             * For STG and ST2G, we need to check alignment and probe memory.
+             * TODO: For STZG and STZ2G, we could rely on the stores below,
+             * at least for system mode; user-only won't enforce alignment.
+             */
+            if (is_pair) {
+                gen_helper_st2g_stub(cpu_env, addr);
+            } else {
+                gen_helper_stg_stub(cpu_env, addr);
+            }
+        } else if (tb_cflags(s->base.tb) & CF_PARALLEL) {
+            if (is_pair) {
+                gen_helper_st2g_parallel(cpu_env, addr, tcg_rt);
+            } else {
+                gen_helper_stg_parallel(cpu_env, addr, tcg_rt);
+            }
+        } else {
+            if (is_pair) {
+                gen_helper_st2g(cpu_env, addr, tcg_rt);
+            } else {
+                gen_helper_stg(cpu_env, addr, tcg_rt);
+            }
+        }
+    }
+
+    if (is_zero) {
+        TCGv_i64 clean_addr = clean_data_tbi(s, addr);
+        TCGv_i64 tcg_zero = tcg_const_i64(0);
+        int mem_index = get_mem_index(s);
+        int i, n = (1 + is_pair) << LOG2_TAG_GRANULE;
+
+        tcg_gen_qemu_st_i64(tcg_zero, clean_addr, mem_index,
+                            MO_Q | MO_ALIGN_16);
+        for (i = 8; i < n; i += 8) {
+            tcg_gen_addi_i64(clean_addr, clean_addr, 8);
+            tcg_gen_qemu_st_i64(tcg_zero, clean_addr, mem_index, MO_Q);
+        }
+        tcg_temp_free_i64(tcg_zero);
+    }
+
+    if (index != 0) {
+        /* pre-index or post-index */
+        if (index < 0) {
+            /* post-index */
+            tcg_gen_addi_i64(addr, addr, offset);
+        }
+        tcg_gen_mov_i64(cpu_reg_sp(s, rn), addr);
+    }
+}
+
 /* Loads and stores */
 static void disas_ldst(DisasContext *s, uint32_t insn)
 {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst(DisasContext *s, uint32_t insn)
     case 0x0d: /* AdvSIMD load/store single structure */
         disas_ldst_single_struct(s, insn);
         break;
-    case 0x19: /* LDAPR/STLR (unscaled immediate) */
-        if (extract32(insn, 10, 2) != 0 ||
-            extract32(insn, 21, 1) != 0) {
+    case 0x19:
+        if (extract32(insn, 21, 1) != 0) {
+            disas_ldst_tag(s, insn);
+        } else if (extract32(insn, 10, 2) == 0) {
+            disas_ldst_ldapr_stlr(s, insn);
+        } else {
             unallocated_encoding(s);
-            break;
         }
-        disas_ldst_ldapr_stlr(s, insn);
         break;
     default:
         unallocated_encoding(s);
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-17-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 29 ++++++++++++++++++++++++++---
 1 file changed, 26 insertions(+), 3 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_ld_lit(DisasContext *s, uint32_t insn)
  * +-----+-------+---+---+-------+---+-------+-------+------+------+
  *
  * opc: LDP/STP/LDNP/STNP        00 -> 32 bit, 10 -> 64 bit
- *      LDPSW                    01
+ *      LDPSW/STGP               01
  *      LDP/STP/LDNP/STNP (SIMD) 00 -> 32 bit, 01 -> 64 bit, 10 -> 128 bit
  *   V: 0 -> GPR, 1 -> Vector
  * idx: 00 -> signed offset with non-temporal hint, 01 -> post-index,
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_pair(DisasContext *s, uint32_t insn)
     bool is_signed = false;
     bool postindex = false;
     bool wback = false;
+    bool set_tag = false;
 
     TCGv_i64 clean_addr, dirty_addr;
 
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_pair(DisasContext *s, uint32_t insn)
 
     if (is_vector) {
         size = 2 + opc;
+    } else if (opc == 1 && !is_load) {
+        /* STGP */
+        if (!dc_isar_feature(aa64_mte_insn_reg, s) || index == 0) {
+            unallocated_encoding(s);
+            return;
+        }
+        size = 3;
+        set_tag = true;
     } else {
         size = 2 + extract32(opc, 1, 1);
         is_signed = extract32(opc, 0, 1);
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_pair(DisasContext *s, uint32_t insn)
         return;
     }
 
-    offset <<= size;
+    offset <<= (set_tag ? LOG2_TAG_GRANULE : size);
 
     if (rn == 31) {
         gen_check_sp_alignment(s);
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_pair(DisasContext *s, uint32_t insn)
     if (!postindex) {
         tcg_gen_addi_i64(dirty_addr, dirty_addr, offset);
     }
-    clean_addr = clean_data_tbi(s, dirty_addr);
 
+    if (set_tag) {
+        if (!s->ata) {
+            /*
+             * TODO: We could rely on the stores below, at least for
+             * system mode, if we arrange to add MO_ALIGN_16.
+             */
+            gen_helper_stg_stub(cpu_env, dirty_addr);
+        } else if (tb_cflags(s->base.tb) & CF_PARALLEL) {
+            gen_helper_stg_parallel(cpu_env, dirty_addr, dirty_addr);
+        } else {
+            gen_helper_stg(cpu_env, dirty_addr, dirty_addr);
+        }
+    }
+
+    clean_addr = clean_data_tbi(s, dirty_addr);
     if (is_vector) {
         if (is_load) {
             do_fp_ld(s, rt, clean_addr, size);
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

We can simplify our DC_ZVA if we recognize that the largest BS
that we actually use in system mode is 64.  Let us just assert
that it fits within TARGET_PAGE_SIZE.

For DC_GVA and STZGM, we want to be able to write whole bytes
of tag memory, so assert that BS is >= 2 * TAG_GRANULE, or 32.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-18-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.c | 24 ++++++++++++++++++++++++
 1 file changed, 24 insertions(+)

diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
     }
 #endif
 
+    if (tcg_enabled()) {
+        int dcz_blocklen = 4 << cpu->dcz_blocksize;
+
+        /*
+         * We only support DCZ blocklen that fits on one page.
+         *
+         * Architectually this is always true.  However TARGET_PAGE_SIZE
+         * is variable and, for compatibility with -machine virt-2.7,
+         * is only 1KiB, as an artifact of legacy ARMv5 subpage support.
+         * But even then, while the largest architectural DCZ blocklen
+         * is 2KiB, no cpu actually uses such a large blocklen.
+         */
+        assert(dcz_blocklen <= TARGET_PAGE_SIZE);
+
+        /*
+         * We only support DCZ blocksize >= 2*TAG_GRANULE, which is to say
+         * both nibbles of each byte storing tag data may be written at once.
+         * Since TAG_GRANULE is 16, this means that blocklen must be >= 32.
+         */
+        if (cpu_isar_feature(aa64_mte, cpu)) {
+            assert(dcz_blocklen >= 2 * TAG_GRANULE);
+        }
+    }
+
     qemu_init_vcpu(cs);
     cpu_reset(cs);
 
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Now that we know that the operation is on a single page,
we need not loop over pages while probing.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-19-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-a64.c | 94 +++++++++++------------------------------
 1 file changed, 25 insertions(+), 69 deletions(-)

diff --git a/target/arm/helper-a64.c b/target/arm/helper-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper-a64.c
+++ b/target/arm/helper-a64.c
@@ -XXX,XX +XXX,XX @@ void HELPER(dc_zva)(CPUARMState *env, uint64_t vaddr_in)
      * (which matches the usual QEMU behaviour of not implementing either
      * alignment faults or any memory attribute handling).
      */
-
-    ARMCPU *cpu = env_archcpu(env);
-    uint64_t blocklen = 4 << cpu->dcz_blocksize;
+    int blocklen = 4 << env_archcpu(env)->dcz_blocksize;
     uint64_t vaddr = vaddr_in & ~(blocklen - 1);
+    int mmu_idx = cpu_mmu_index(env, false);
+    void *mem;
+
+    /*
+     * Trapless lookup.  In addition to actual invalid page, may
+     * return NULL for I/O, watchpoints, clean pages, etc.
+     */
+    mem = tlb_vaddr_to_host(env, vaddr, MMU_DATA_STORE, mmu_idx);
 
 #ifndef CONFIG_USER_ONLY
-    {
+    if (unlikely(!mem)) {
+        uintptr_t ra = GETPC();
+
         /*
-         * Slightly awkwardly, QEMU's TARGET_PAGE_SIZE may be less than
-         * the block size so we might have to do more than one TLB lookup.
-         * We know that in fact for any v8 CPU the page size is at least 4K
-         * and the block size must be 2K or less, but TARGET_PAGE_SIZE is only
-         * 1K as an artefact of legacy v5 subpage support being present in the
-         * same QEMU executable. So in practice the hostaddr[] array has
-         * two entries, given the current setting of TARGET_PAGE_BITS_MIN.
+         * Trap if accessing an invalid page.  DC_ZVA requires that we supply
+         * the original pointer for an invalid page.  But watchpoints require
+         * that we probe the actual space.  So do both.
          */
-        int maxidx = DIV_ROUND_UP(blocklen, TARGET_PAGE_SIZE);
-        void *hostaddr[DIV_ROUND_UP(2 * KiB, 1 << TARGET_PAGE_BITS_MIN)];
-        int try, i;
-        unsigned mmu_idx = cpu_mmu_index(env, false);
-        TCGMemOpIdx oi = make_memop_idx(MO_UB, mmu_idx);
+        (void) probe_write(env, vaddr_in, 1, mmu_idx, ra);
+        mem = probe_write(env, vaddr, blocklen, mmu_idx, ra);
 
-        assert(maxidx <= ARRAY_SIZE(hostaddr));
-
-        for (try = 0; try < 2; try++) {
-
-            for (i = 0; i < maxidx; i++) {
-                hostaddr[i] = tlb_vaddr_to_host(env,
-                                                vaddr + TARGET_PAGE_SIZE * i,
-                                                1, mmu_idx);
-                if (!hostaddr[i]) {
-                    break;
-                }
-            }
-            if (i == maxidx) {
-                /*
-                 * If it's all in the TLB it's fair game for just writing to;
-                 * we know we don't need to update dirty status, etc.
-                 */
-                for (i = 0; i < maxidx - 1; i++) {
-                    memset(hostaddr[i], 0, TARGET_PAGE_SIZE);
-                }
-                memset(hostaddr[i], 0, blocklen - (i * TARGET_PAGE_SIZE));
-                return;
-            }
+        if (unlikely(!mem)) {
             /*
-             * OK, try a store and see if we can populate the tlb. This
-             * might cause an exception if the memory isn't writable,
-             * in which case we will longjmp out of here. We must for
-             * this purpose use the actual register value passed to us
-             * so that we get the fault address right.
+             * The only remaining reason for mem == NULL is I/O.
+             * Just do a series of byte writes as the architecture demands.
              */
-            helper_ret_stb_mmu(env, vaddr_in, 0, oi, GETPC());
-            /* Now we can populate the other TLB entries, if any */
-            for (i = 0; i < maxidx; i++) {
-                uint64_t va = vaddr + TARGET_PAGE_SIZE * i;
-                if (va != (vaddr_in & TARGET_PAGE_MASK)) {
-                    helper_ret_stb_mmu(env, va, 0, oi, GETPC());
-                }
+            for (int i = 0; i < blocklen; i++) {
+                cpu_stb_mmuidx_ra(env, vaddr + i, 0, mmu_idx, ra);
             }
-        }
-
-        /*
-         * Slow path (probably attempt to do this to an I/O device or
-         * similar, or clearing of a block of code we have translations
-         * cached for). Just do a series of byte writes as the architecture
-         * demands. It's not worth trying to use a cpu_physical_memory_map(),
-         * memset(), unmap() sequence here because:
-         *  + we'd need to account for the blocksize being larger than a page
-         *  + the direct-RAM access case is almost always going to be dealt
-         *    with in the fastpath code above, so there's no speed benefit
-         *  + we would have to deal with the map returning NULL because the
-         *    bounce buffer was in use
-         */
-        for (i = 0; i < blocklen; i++) {
-            helper_ret_stb_mmu(env, vaddr + i, 0, oi, GETPC());
+            return;
         }
     }
-#else
-    memset(g2h(vaddr), 0, blocklen);
 #endif
+
+    memset(mem, 0, blocklen);
 }
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-20-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-a64.h    |  3 ++
 target/arm/translate.h     |  2 +
 target/arm/mte_helper.c    | 84 ++++++++++++++++++++++++++++++++++++++
 target/arm/translate-a64.c | 72 ++++++++++++++++++++++++++++----
 4 files changed, 153 insertions(+), 8 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Like the regular data cache flushes, these are nops within qemu.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-21-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper.c | 65 +++++++++++++++++++++++++++++++++++++++++++++
 1 file changed, 65 insertions(+)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo mte_reginfo[] = {
       .opc0 = 3, .opc1 = 3, .crn = 4, .crm = 2, .opc2 = 7,
       .type = ARM_CP_NO_RAW,
       .access = PL0_RW, .readfn = tco_read, .writefn = tco_write },
+    { .name = "DC_IGVAC", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 0, .crn = 7, .crm = 6, .opc2 = 3,
+      .type = ARM_CP_NOP, .access = PL1_W,
+      .accessfn = aa64_cacheop_poc_access },
+    { .name = "DC_IGSW", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 0, .crn = 7, .crm = 6, .opc2 = 4,
+      .type = ARM_CP_NOP, .access = PL1_W, .accessfn = access_tsw },
+    { .name = "DC_IGDVAC", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 0, .crn = 7, .crm = 6, .opc2 = 5,
+      .type = ARM_CP_NOP, .access = PL1_W,
+      .accessfn = aa64_cacheop_poc_access },
+    { .name = "DC_IGDSW", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 0, .crn = 7, .crm = 6, .opc2 = 6,
+      .type = ARM_CP_NOP, .access = PL1_W, .accessfn = access_tsw },
+    { .name = "DC_CGSW", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 0, .crn = 7, .crm = 10, .opc2 = 4,
+      .type = ARM_CP_NOP, .access = PL1_W, .accessfn = access_tsw },
+    { .name = "DC_CGDSW", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 0, .crn = 7, .crm = 10, .opc2 = 6,
+      .type = ARM_CP_NOP, .access = PL1_W, .accessfn = access_tsw },
+    { .name = "DC_CIGSW", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 0, .crn = 7, .crm = 14, .opc2 = 4,
+      .type = ARM_CP_NOP, .access = PL1_W, .accessfn = access_tsw },
+    { .name = "DC_CIGDSW", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 0, .crn = 7, .crm = 14, .opc2 = 6,
+      .type = ARM_CP_NOP, .access = PL1_W, .accessfn = access_tsw },
     REGINFO_SENTINEL
 };
 
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo mte_tco_ro_reginfo[] = {
       .type = ARM_CP_CONST, .access = PL0_RW, },
     REGINFO_SENTINEL
 };
+
+static const ARMCPRegInfo mte_el0_cacheop_reginfo[] = {
+    { .name = "DC_CGVAC", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 10, .opc2 = 3,
+      .type = ARM_CP_NOP, .access = PL0_W,
+      .accessfn = aa64_cacheop_poc_access },
+    { .name = "DC_CGDVAC", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 10, .opc2 = 5,
+      .type = ARM_CP_NOP, .access = PL0_W,
+      .accessfn = aa64_cacheop_poc_access },
+    { .name = "DC_CGVAP", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 12, .opc2 = 3,
+      .type = ARM_CP_NOP, .access = PL0_W,
+      .accessfn = aa64_cacheop_poc_access },
+    { .name = "DC_CGDVAP", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 12, .opc2 = 5,
+      .type = ARM_CP_NOP, .access = PL0_W,
+      .accessfn = aa64_cacheop_poc_access },
+    { .name = "DC_CGVADP", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 13, .opc2 = 3,
+      .type = ARM_CP_NOP, .access = PL0_W,
+      .accessfn = aa64_cacheop_poc_access },
+    { .name = "DC_CGDVADP", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 13, .opc2 = 5,
+      .type = ARM_CP_NOP, .access = PL0_W,
+      .accessfn = aa64_cacheop_poc_access },
+    { .name = "DC_CIGVAC", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 14, .opc2 = 3,
+      .type = ARM_CP_NOP, .access = PL0_W,
+      .accessfn = aa64_cacheop_poc_access },
+    { .name = "DC_CIGDVAC", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 14, .opc2 = 5,
+      .type = ARM_CP_NOP, .access = PL0_W,
+      .accessfn = aa64_cacheop_poc_access },
+    REGINFO_SENTINEL
+};
+
 #endif
 
 static CPAccessResult access_predinv(CPUARMState *env, const ARMCPRegInfo *ri,
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
      */
     if (cpu_isar_feature(aa64_mte, cpu)) {
         define_arm_cp_regs(cpu, mte_reginfo);
+        define_arm_cp_regs(cpu, mte_el0_cacheop_reginfo);
     } else if (cpu_isar_feature(aa64_mte_insn_reg, cpu)) {
         define_arm_cp_regs(cpu, mte_tco_ro_reginfo);
+        define_arm_cp_regs(cpu, mte_el0_cacheop_reginfo);
     }
 #endif
 
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

We will shortly need this in mte_helper.c as well.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-22-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/internals.h | 36 ++++++++++++++++++++++++++++++++++++
 target/arm/helper.c    | 36 ------------------------------------
 2 files changed, 36 insertions(+), 36 deletions(-)

diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ static inline bool regime_is_pan(CPUARMState *env, ARMMMUIdx mmu_idx)
     }
 }
 
+/* Return the exception level which controls this address translation regime */
+static inline uint32_t regime_el(CPUARMState *env, ARMMMUIdx mmu_idx)
+{
+    switch (mmu_idx) {
+    case ARMMMUIdx_E20_0:
+    case ARMMMUIdx_E20_2:
+    case ARMMMUIdx_E20_2_PAN:
+    case ARMMMUIdx_Stage2:
+    case ARMMMUIdx_E2:
+        return 2;
+    case ARMMMUIdx_SE3:
+        return 3;
+    case ARMMMUIdx_SE10_0:
+        return arm_el_is_aa64(env, 3) ? 1 : 3;
+    case ARMMMUIdx_SE10_1:
+    case ARMMMUIdx_SE10_1_PAN:
+    case ARMMMUIdx_Stage1_E0:
+    case ARMMMUIdx_Stage1_E1:
+    case ARMMMUIdx_Stage1_E1_PAN:
+    case ARMMMUIdx_E10_0:
+    case ARMMMUIdx_E10_1:
+    case ARMMMUIdx_E10_1_PAN:
+    case ARMMMUIdx_MPrivNegPri:
+    case ARMMMUIdx_MUserNegPri:
+    case ARMMMUIdx_MPriv:
+    case ARMMMUIdx_MUser:
+    case ARMMMUIdx_MSPrivNegPri:
+    case ARMMMUIdx_MSUserNegPri:
+    case ARMMMUIdx_MSPriv:
+    case ARMMMUIdx_MSUser:
+        return 1;
+    default:
+        g_assert_not_reached();
+    }
+}
+
 /* Return the FSR value for a debug exception (watchpoint, hardware
  * breakpoint or BKPT insn) targeting the specified exception level.
  */
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void arm_cpu_do_interrupt(CPUState *cs)
 }
 #endif /* !CONFIG_USER_ONLY */
 
-/* Return the exception level which controls this address translation regime */
-static uint32_t regime_el(CPUARMState *env, ARMMMUIdx mmu_idx)
-{
-    switch (mmu_idx) {
-    case ARMMMUIdx_E20_0:
-    case ARMMMUIdx_E20_2:
-    case ARMMMUIdx_E20_2_PAN:
-    case ARMMMUIdx_Stage2:
-    case ARMMMUIdx_E2:
-        return 2;
-    case ARMMMUIdx_SE3:
-        return 3;
-    case ARMMMUIdx_SE10_0:
-        return arm_el_is_aa64(env, 3) ? 1 : 3;
-    case ARMMMUIdx_SE10_1:
-    case ARMMMUIdx_SE10_1_PAN:
-    case ARMMMUIdx_Stage1_E0:
-    case ARMMMUIdx_Stage1_E1:
-    case ARMMMUIdx_Stage1_E1_PAN:
-    case ARMMMUIdx_E10_0:
-    case ARMMMUIdx_E10_1:
-    case ARMMMUIdx_E10_1_PAN:
-    case ARMMMUIdx_MPrivNegPri:
-    case ARMMMUIdx_MUserNegPri:
-    case ARMMMUIdx_MPriv:
-    case ARMMMUIdx_MUser:
-    case ARMMMUIdx_MSPrivNegPri:
-    case ARMMMUIdx_MSUserNegPri:
-    case ARMMMUIdx_MSPriv:
-    case ARMMMUIdx_MSUser:
-        return 1;
-    default:
-        g_assert_not_reached();
-    }
-}
-
 uint64_t arm_sctlr(CPUARMState *env, int el)
 {
     /* Only EL0 needs to be adjusted for EL1&0 or EL2&0. */
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

We will shortly need this in mte_helper.c as well.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-23-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/internals.h | 9 +++++++++
 target/arm/helper.c    | 9 ---------
 2 files changed, 9 insertions(+), 9 deletions(-)

diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ static inline uint32_t regime_el(CPUARMState *env, ARMMMUIdx mmu_idx)
     }
 }
 
+/* Return the TCR controlling this translation regime */
+static inline TCR *regime_tcr(CPUARMState *env, ARMMMUIdx mmu_idx)
+{
+    if (mmu_idx == ARMMMUIdx_Stage2) {
+        return &env->cp15.vtcr_el2;
+    }
+    return &env->cp15.tcr_el[regime_el(env, mmu_idx)];
+}
+
 /* Return the FSR value for a debug exception (watchpoint, hardware
  * breakpoint or BKPT insn) targeting the specified exception level.
  */
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static inline uint64_t regime_ttbr(CPUARMState *env, ARMMMUIdx mmu_idx,
 
 #endif /* !CONFIG_USER_ONLY */
 
-/* Return the TCR controlling this translation regime */
-static inline TCR *regime_tcr(CPUARMState *env, ARMMMUIdx mmu_idx)
-{
-    if (mmu_idx == ARMMMUIdx_Stage2) {
-        return &env->cp15.vtcr_el2;
-    }
-    return &env->cp15.tcr_el[regime_el(env, mmu_idx)];
-}
-
 /* Convert a possible stage1+2 MMU index into the appropriate
  * stage 1 MMU index
  */
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Replace existing uses of check_data_tbi in translate-a64.c that
perform a single logical memory access.  Leave the helper blank
for now to reduce the patch size.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-24-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-a64.h    |   1 +
 target/arm/internals.h     |   8 +++
 target/arm/translate-a64.h |   2 +
 target/arm/mte_helper.c    |   8 +++
 target/arm/translate-a64.c | 100 ++++++++++++++++++++++++++++---------
 5 files changed, 95 insertions(+), 24 deletions(-)

diff --git a/target/arm/helper-a64.h b/target/arm/helper-a64.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper-a64.h
+++ b/target/arm/helper-a64.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_3(autdb, TCG_CALL_NO_WG, i64, env, i64, i64)
 DEF_HELPER_FLAGS_2(xpaci, TCG_CALL_NO_RWG_SE, i64, env, i64)
 DEF_HELPER_FLAGS_2(xpacd, TCG_CALL_NO_RWG_SE, i64, env, i64)
 
+DEF_HELPER_FLAGS_3(mte_check1, TCG_CALL_NO_WG, i64, env, i32, i64)
 DEF_HELPER_FLAGS_3(irg, TCG_CALL_NO_RWG, i64, env, i64, i64)
 DEF_HELPER_FLAGS_4(addsubg, TCG_CALL_NO_RWG_SE, i64, env, i64, s32, i32)
 DEF_HELPER_FLAGS_3(ldg, TCG_CALL_NO_WG, i64, env, i64, i64)
diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ void arm_log_exception(int idx);
 #define LOG2_TAG_GRANULE 4
 #define TAG_GRANULE      (1 << LOG2_TAG_GRANULE)
 
+/* Bits within a descriptor passed to the helper_mte_check* functions. */
+FIELD(MTEDESC, MIDX,  0, 4)
+FIELD(MTEDESC, TBI,   4, 2)
+FIELD(MTEDESC, TCMA,  6, 2)
+FIELD(MTEDESC, WRITE, 8, 1)
+FIELD(MTEDESC, ESIZE, 9, 5)
+FIELD(MTEDESC, TSIZE, 14, 10)  /* mte_checkN only */
+
 static inline int allocation_tag_from_addr(uint64_t ptr)
 {
     return extract64(ptr, 56, 4);
diff --git a/target/arm/translate-a64.h b/target/arm/translate-a64.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.h
+++ b/target/arm/translate-a64.h
@@ -XXX,XX +XXX,XX @@ TCGv_ptr get_fpstatus_ptr(bool);
 bool logic_imm_decode_wmask(uint64_t *result, unsigned int immn,
                             unsigned int imms, unsigned int immr);
 bool sve_access_check(DisasContext *s);
+TCGv_i64 gen_mte_check1(DisasContext *s, TCGv_i64 addr, bool is_write,
+                        bool tag_checked, int log2_size);
 
 /* We should have at some point before trying to access an FP register
  * done the necessary access check, so assert that
diff --git a/target/arm/mte_helper.c b/target/arm/mte_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/mte_helper.c
+++ b/target/arm/mte_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(stzgm_tags)(CPUARMState *env, uint64_t ptr, uint64_t val)
         memset(mem, tag_pair, tag_bytes);
     }
 }
+
+/*
+ * Perform an MTE checked access for a single logical or atomic access.
+ */
+uint64_t HELPER(mte_check1)(CPUARMState *env, uint32_t desc, uint64_t ptr)
+{
+    return ptr;
+}
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void gen_a64_set_pc(DisasContext *s, TCGv_i64 src)
 }
 
 /*
- * Return a "clean" address for ADDR according to TBID.
- * This is always a fresh temporary, as we need to be able to
- * increment this independently of a dirty write-back address.
+ * Handle MTE and/or TBI.
+ *
+ * For TBI, ideally, we would do nothing.  Proper behaviour on fault is
+ * for the tag to be present in the FAR_ELx register.  But for user-only
+ * mode we do not have a TLB with which to implement this, so we must
+ * remove the top byte now.
+ *
+ * Always return a fresh temporary that we can increment independently
+ * of the write-back address.
  */
+
 static TCGv_i64 clean_data_tbi(DisasContext *s, TCGv_i64 addr)
 {
     TCGv_i64 clean = new_tmp_a64(s);
-    /*
-     * In order to get the correct value in the FAR_ELx register,
-     * we must present the memory subsystem with the "dirty" address
-     * including the TBI.  In system mode we can make this work via
-     * the TLB, dropping the TBI during translation.  But for user-only
-     * mode we don't have that option, and must remove the top byte now.
-     */
 #ifdef CONFIG_USER_ONLY
     gen_top_byte_ignore(s, clean, addr, s->tbid);
 #else
@@ -XXX,XX +XXX,XX @@ static void gen_probe_access(DisasContext *s, TCGv_i64 ptr,
     tcg_temp_free_i32(t_size);
 }
 
+/*
+ * For MTE, check a single logical or atomic access.  This probes a single
+ * address, the exact one specified.  The size and alignment of the access
+ * is not relevant to MTE, per se, but watchpoints do require the size,
+ * and we want to recognize those before making any other changes to state.
+ */
+static TCGv_i64 gen_mte_check1_mmuidx(DisasContext *s, TCGv_i64 addr,
+                                      bool is_write, bool tag_checked,
+                                      int log2_size, bool is_unpriv,
+                                      int core_idx)
+{
+    if (tag_checked && s->mte_active[is_unpriv]) {
+        TCGv_i32 tcg_desc;
+        TCGv_i64 ret;
+        int desc = 0;
+
+        desc = FIELD_DP32(desc, MTEDESC, MIDX, core_idx);
+        desc = FIELD_DP32(desc, MTEDESC, TBI, s->tbid);
+        desc = FIELD_DP32(desc, MTEDESC, TCMA, s->tcma);
+        desc = FIELD_DP32(desc, MTEDESC, WRITE, is_write);
+        desc = FIELD_DP32(desc, MTEDESC, ESIZE, 1 << log2_size);
+        tcg_desc = tcg_const_i32(desc);
+
+        ret = new_tmp_a64(s);
+        gen_helper_mte_check1(ret, cpu_env, tcg_desc, addr);
+        tcg_temp_free_i32(tcg_desc);
+
+        return ret;
+    }
+    return clean_data_tbi(s, addr);
+}
+
+TCGv_i64 gen_mte_check1(DisasContext *s, TCGv_i64 addr, bool is_write,
+                        bool tag_checked, int log2_size)
+{
+    return gen_mte_check1_mmuidx(s, addr, is_write, tag_checked, log2_size,
+                                 false, get_mem_index(s));
+}
+
 typedef struct DisasCompare64 {
     TCGCond cond;
     TCGv_i64 value;
@@ -XXX,XX +XXX,XX @@ static void gen_compare_and_swap(DisasContext *s, int rs, int rt,
     if (rn == 31) {
         gen_check_sp_alignment(s);
     }
-    clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
+    clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn), true, rn != 31, size);
     tcg_gen_atomic_cmpxchg_i64(tcg_rs, clean_addr, tcg_rs, tcg_rt, memidx,
                                size | MO_ALIGN | s->be_data);
 }
@@ -XXX,XX +XXX,XX @@ static void gen_compare_and_swap_pair(DisasContext *s, int rs, int rt,
     if (rn == 31) {
         gen_check_sp_alignment(s);
     }
-    clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
+
+    /* This is a single atomic access, despite the "pair". */
+    clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn), true, rn != 31, size + 1);
 
     if (size == 2) {
         TCGv_i64 cmp = tcg_temp_new_i64();
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
         if (is_lasr) {
             tcg_gen_mb(TCG_MO_ALL | TCG_BAR_STRL);
         }
-        clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
+        clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn),
+                                    true, rn != 31, size);
         gen_store_exclusive(s, rs, rt, rt2, clean_addr, size, false);
         return;
 
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
         if (rn == 31) {
             gen_check_sp_alignment(s);
         }
-        clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
+        clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn),
+                                    false, rn != 31, size);
         s->is_ldex = true;
         gen_load_exclusive(s, rt, rt2, clean_addr, size, false);
         if (is_lasr) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
             gen_check_sp_alignment(s);
         }
         tcg_gen_mb(TCG_MO_ALL | TCG_BAR_STRL);
-        clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
+        clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn),
+                                    true, rn != 31, size);
         do_gpr_st(s, cpu_reg(s, rt), clean_addr, size, true, rt,
                   disas_ldst_compute_iss_sf(size, false, 0), is_lasr);
         return;
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
         if (rn == 31) {
             gen_check_sp_alignment(s);
         }
-        clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
+        clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn),
+                                    false, rn != 31, size);
         do_gpr_ld(s, cpu_reg(s, rt), clean_addr, size, false, false, true, rt,
                   disas_ldst_compute_iss_sf(size, false, 0), is_lasr);
         tcg_gen_mb(TCG_MO_ALL | TCG_BAR_LDAQ);
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
             if (is_lasr) {
                 tcg_gen_mb(TCG_MO_ALL | TCG_BAR_STRL);
             }
-            clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
+            clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn),
+                                        true, rn != 31, size);
             gen_store_exclusive(s, rs, rt, rt2, clean_addr, size, true);
             return;
         }
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_excl(DisasContext *s, uint32_t insn)
             if (rn == 31) {
                 gen_check_sp_alignment(s);
             }
-            clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
+            clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn),
+                                        false, rn != 31, size);
             s->is_ldex = true;
             gen_load_exclusive(s, rt, rt2, clean_addr, size, true);
             if (is_lasr) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_reg_imm9(DisasContext *s, uint32_t insn,
     bool iss_valid = !is_vector;
     bool post_index;
     bool writeback;
+    int memidx;
 
     TCGv_i64 clean_addr, dirty_addr;
 
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_reg_imm9(DisasContext *s, uint32_t insn,
     if (!post_index) {
         tcg_gen_addi_i64(dirty_addr, dirty_addr, imm9);
     }
-    clean_addr = clean_data_tbi(s, dirty_addr);
+
+    memidx = is_unpriv ? get_a64_user_mem_index(s) : get_mem_index(s);
+    clean_addr = gen_mte_check1_mmuidx(s, dirty_addr, is_store,
+                                       writeback || rn != 31,
+                                       size, is_unpriv, memidx);
 
     if (is_vector) {
         if (is_store) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_reg_imm9(DisasContext *s, uint32_t insn,
         }
     } else {
         TCGv_i64 tcg_rt = cpu_reg(s, rt);
-        int memidx = is_unpriv ? get_a64_user_mem_index(s) : get_mem_index(s);
         bool iss_sf = disas_ldst_compute_iss_sf(size, is_signed, opc);
 
         if (is_store) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_reg_roffset(DisasContext *s, uint32_t insn,
     ext_and_shift_reg(tcg_rm, tcg_rm, opt, shift ? size : 0);
 
     tcg_gen_add_i64(dirty_addr, dirty_addr, tcg_rm);
-    clean_addr = clean_data_tbi(s, dirty_addr);
+    clean_addr = gen_mte_check1(s, dirty_addr, is_store, true, size);
 
     if (is_vector) {
         if (is_store) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_reg_unsigned_imm(DisasContext *s, uint32_t insn,
     dirty_addr = read_cpu_reg_sp(s, rn, 1);
     offset = imm12 << size;
     tcg_gen_addi_i64(dirty_addr, dirty_addr, offset);
-    clean_addr = clean_data_tbi(s, dirty_addr);
+    clean_addr = gen_mte_check1(s, dirty_addr, is_store, rn != 31, size);
 
     if (is_vector) {
         if (is_store) {
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_atomic(DisasContext *s, uint32_t insn,
     if (rn == 31) {
         gen_check_sp_alignment(s);
     }
-    clean_addr = clean_data_tbi(s, cpu_reg_sp(s, rn));
+    clean_addr = gen_mte_check1(s, cpu_reg_sp(s, rn), false, rn != 31, size);
 
     if (o3_opc == 014) {
         /*
@@ -XXX,XX +XXX,XX @@ static void disas_ldst_pac(DisasContext *s, uint32_t insn,
     tcg_gen_addi_i64(dirty_addr, dirty_addr, offset);
 
     /* Note that "clean" and "dirty" here refer to TBI not PAC.  */
-    clean_addr = clean_data_tbi(s, dirty_addr);
+    clean_addr = gen_mte_check1(s, dirty_addr, false,
+                                is_wback || rn != 31, size);
 
     tcg_rt = cpu_reg(s, rt);
     do_gpr_ld(s, tcg_rt, clean_addr, size, /* is_signed */ false,
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Replace existing uses of check_data_tbi in translate-a64.c that
perform multiple logical memory access.  Leave the helper blank
for now to reduce the patch size.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-25-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-a64.h    |  1 +
 target/arm/translate-a64.h |  2 ++
 target/arm/mte_helper.c    |  8 +++++
 target/arm/translate-a64.c | 71 +++++++++++++++++++++++++++++---------
 4 files changed, 66 insertions(+), 16 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Fill out the stub that was added earlier.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-26-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/internals.h  |  48 +++++++++++++++
 target/arm/mte_helper.c | 132 +++++++++++++++++++++++++++++++++++++++-
 2 files changed, 179 insertions(+), 1 deletion(-)

diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ FIELD(MTEDESC, WRITE, 8, 1)
 FIELD(MTEDESC, ESIZE, 9, 5)
 FIELD(MTEDESC, TSIZE, 14, 10)  /* mte_checkN only */
 
+bool mte_probe1(CPUARMState *env, uint32_t desc, uint64_t ptr);
+uint64_t mte_check1(CPUARMState *env, uint32_t desc,
+                    uint64_t ptr, uintptr_t ra);
+
 static inline int allocation_tag_from_addr(uint64_t ptr)
 {
     return extract64(ptr, 56, 4);
@@ -XXX,XX +XXX,XX @@ static inline uint64_t address_with_allocation_tag(uint64_t ptr, int rtag)
     return deposit64(ptr, 56, 4, rtag);
 }
 
+/* Return true if tbi bits mean that the access is checked.  */
+static inline bool tbi_check(uint32_t desc, int bit55)
+{
+    return (desc >> (R_MTEDESC_TBI_SHIFT + bit55)) & 1;
+}
+
+/* Return true if tcma bits mean that the access is unchecked.  */
+static inline bool tcma_check(uint32_t desc, int bit55, int ptr_tag)
+{
+    /*
+     * We had extracted bit55 and ptr_tag for other reasons, so fold
+     * (ptr<59:55> == 00000 || ptr<59:55> == 11111) into a single test.
+     */
+    bool match = ((ptr_tag + bit55) & 0xf) == 0;
+    bool tcma = (desc >> (R_MTEDESC_TCMA_SHIFT + bit55)) & 1;
+    return tcma && match;
+}
+
+/*
+ * For TBI, ideally, we would do nothing.  Proper behaviour on fault is
+ * for the tag to be present in the FAR_ELx register.  But for user-only
+ * mode, we do not have a TLB with which to implement this, so we must
+ * remove the top byte.
+ */
+static inline uint64_t useronly_clean_ptr(uint64_t ptr)
+{
+    /* TBI is known to be enabled. */
+#ifdef CONFIG_USER_ONLY
+    ptr = sextract64(ptr, 0, 56);
+#endif
+    return ptr;
+}
+
+static inline uint64_t useronly_maybe_clean_ptr(uint32_t desc, uint64_t ptr)
+{
+#ifdef CONFIG_USER_ONLY
+    int64_t clean_ptr = sextract64(ptr, 0, 56);
+    if (tbi_check(desc, clean_ptr < 0)) {
+        ptr = clean_ptr;
+    }
+#endif
+    return ptr;
+}
+
 #endif
diff --git a/target/arm/mte_helper.c b/target/arm/mte_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/mte_helper.c
+++ b/target/arm/mte_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(stzgm_tags)(CPUARMState *env, uint64_t ptr, uint64_t val)
     }
 }
 
+/* Record a tag check failure.  */
+static void mte_check_fail(CPUARMState *env, int mmu_idx,
+                           uint64_t dirty_ptr, uintptr_t ra)
+{
+    ARMMMUIdx arm_mmu_idx = core_to_aa64_mmu_idx(mmu_idx);
+    int el, reg_el, tcf, select;
+    uint64_t sctlr;
+
+    reg_el = regime_el(env, arm_mmu_idx);
+    sctlr = env->cp15.sctlr_el[reg_el];
+
+    switch (arm_mmu_idx) {
+    case ARMMMUIdx_E10_0:
+    case ARMMMUIdx_E20_0:
+        el = 0;
+        tcf = extract64(sctlr, 38, 2);
+        break;
+    default:
+        el = reg_el;
+        tcf = extract64(sctlr, 40, 2);
+    }
+
+    switch (tcf) {
+    case 1:
+        /*
+         * Tag check fail causes a synchronous exception.
+         *
+         * In restore_state_to_opc, we set the exception syndrome
+         * for the load or store operation.  Unwind first so we
+         * may overwrite that with the syndrome for the tag check.
+         */
+        cpu_restore_state(env_cpu(env), ra, true);
+        env->exception.vaddress = dirty_ptr;
+        raise_exception(env, EXCP_DATA_ABORT,
+                        syn_data_abort_no_iss(el != 0, 0, 0, 0, 0, 0, 0x11),
+                        exception_target_el(env));
+        /* noreturn, but fall through to the assert anyway */
+
+    case 0:
+        /*
+         * Tag check fail does not affect the PE.
+         * We eliminate this case by not setting MTE_ACTIVE
+         * in tb_flags, so that we never make this runtime call.
+         */
+        g_assert_not_reached();
+
+    case 2:
+        /* Tag check fail causes asynchronous flag set.  */
+        mmu_idx = arm_mmu_idx_el(env, el);
+        if (regime_has_2_ranges(mmu_idx)) {
+            select = extract64(dirty_ptr, 55, 1);
+        } else {
+            select = 0;
+        }
+        env->cp15.tfsr_el[el] |= 1 << select;
+        break;
+
+    default:
+        /* Case 3: Reserved. */
+        qemu_log_mask(LOG_GUEST_ERROR,
+                      "Tag check failure with SCTLR_EL%d.TCF%s "
+                      "set to reserved value %d\n",
+                      reg_el, el ? "" : "0", tcf);
+        break;
+    }
+}
+
 /*
  * Perform an MTE checked access for a single logical or atomic access.
  */
+static bool mte_probe1_int(CPUARMState *env, uint32_t desc, uint64_t ptr,
+                           uintptr_t ra, int bit55)
+{
+    int mem_tag, mmu_idx, ptr_tag, size;
+    MMUAccessType type;
+    uint8_t *mem;
+
+    ptr_tag = allocation_tag_from_addr(ptr);
+
+    if (tcma_check(desc, bit55, ptr_tag)) {
+        return true;
+    }
+
+    mmu_idx = FIELD_EX32(desc, MTEDESC, MIDX);
+    type = FIELD_EX32(desc, MTEDESC, WRITE) ? MMU_DATA_STORE : MMU_DATA_LOAD;
+    size = FIELD_EX32(desc, MTEDESC, ESIZE);
+
+    mem = allocation_tag_mem(env, mmu_idx, ptr, type, size,
+                             MMU_DATA_LOAD, 1, ra);
+    if (!mem) {
+        return true;
+    }
+
+    mem_tag = load_tag1(ptr, mem);
+    return ptr_tag == mem_tag;
+}
+
+/*
+ * No-fault version of mte_check1, to be used by SVE for MemSingleNF.
+ * Returns false if the access is Checked and the check failed.  This
+ * is only intended to probe the tag -- the validity of the page must
+ * be checked beforehand.
+ */
+bool mte_probe1(CPUARMState *env, uint32_t desc, uint64_t ptr)
+{
+    int bit55 = extract64(ptr, 55, 1);
+
+    /* If TBI is disabled, the access is unchecked. */
+    if (unlikely(!tbi_check(desc, bit55))) {
+        return true;
+    }
+
+    return mte_probe1_int(env, desc, ptr, 0, bit55);
+}
+
+uint64_t mte_check1(CPUARMState *env, uint32_t desc,
+                    uint64_t ptr, uintptr_t ra)
+{
+    int bit55 = extract64(ptr, 55, 1);
+
+    /* If TBI is disabled, the access is unchecked, and ptr is not dirty. */
+    if (unlikely(!tbi_check(desc, bit55))) {
+        return ptr;
+    }
+
+    if (unlikely(!mte_probe1_int(env, desc, ptr, ra, bit55))) {
+        int mmu_idx = FIELD_EX32(desc, MTEDESC, MIDX);
+        mte_check_fail(env, mmu_idx, ptr, ra);
+    }
+
+    return useronly_clean_ptr(ptr);
+}
+
 uint64_t HELPER(mte_check1)(CPUARMState *env, uint32_t desc, uint64_t ptr)
 {
-    return ptr;
+    return mte_check1(env, desc, ptr, GETPC());
 }
 
 /*
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Fill out the stub that was added earlier.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-27-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/internals.h  |   2 +
 target/arm/mte_helper.c | 165 +++++++++++++++++++++++++++++++++++++++-
 2 files changed, 166 insertions(+), 1 deletion(-)

diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ FIELD(MTEDESC, TSIZE, 14, 10)  /* mte_checkN only */
 bool mte_probe1(CPUARMState *env, uint32_t desc, uint64_t ptr);
 uint64_t mte_check1(CPUARMState *env, uint32_t desc,
                     uint64_t ptr, uintptr_t ra);
+uint64_t mte_checkN(CPUARMState *env, uint32_t desc,
+                    uint64_t ptr, uintptr_t ra);
 
 static inline int allocation_tag_from_addr(uint64_t ptr)
 {
diff --git a/target/arm/mte_helper.c b/target/arm/mte_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/mte_helper.c
+++ b/target/arm/mte_helper.c
@@ -XXX,XX +XXX,XX @@ uint64_t HELPER(mte_check1)(CPUARMState *env, uint32_t desc, uint64_t ptr)
 /*
  * Perform an MTE checked access for multiple logical accesses.
  */
+
+/**
+ * checkN:
+ * @tag: tag memory to test
+ * @odd: true to begin testing at tags at odd nibble
+ * @cmp: the tag to compare against
+ * @count: number of tags to test
+ *
+ * Return the number of successful tests.
+ * Thus a return value < @count indicates a failure.
+ *
+ * A note about sizes: count is expected to be small.
+ *
+ * The most common use will be LDP/STP of two integer registers,
+ * which means 16 bytes of memory touching at most 2 tags, but
+ * often the access is aligned and thus just 1 tag.
+ *
+ * Using AdvSIMD LD/ST (multiple), one can access 64 bytes of memory,
+ * touching at most 5 tags.  SVE LDR/STR (vector) with the default
+ * vector length is also 64 bytes; the maximum architectural length
+ * is 256 bytes touching at most 9 tags.
+ *
+ * The loop below uses 7 logical operations and 1 memory operation
+ * per tag pair.  An implementation that loads an aligned word and
+ * uses masking to ignore adjacent tags requires 18 logical operations
+ * and thus does not begin to pay off until 6 tags.
+ * Which, according to the survey above, is unlikely to be common.
+ */
+static int checkN(uint8_t *mem, int odd, int cmp, int count)
+{
+    int n = 0, diff;
+
+    /* Replicate the test tag and compare.  */
+    cmp *= 0x11;
+    diff = *mem++ ^ cmp;
+
+    if (odd) {
+        goto start_odd;
+    }
+
+    while (1) {
+        /* Test even tag. */
+        if (unlikely((diff) & 0x0f)) {
+            break;
+        }
+        if (++n == count) {
+            break;
+        }
+
+    start_odd:
+        /* Test odd tag. */
+        if (unlikely((diff) & 0xf0)) {
+            break;
+        }
+        if (++n == count) {
+            break;
+        }
+
+        diff = *mem++ ^ cmp;
+    }
+    return n;
+}
+
+uint64_t mte_checkN(CPUARMState *env, uint32_t desc,
+                    uint64_t ptr, uintptr_t ra)
+{
+    int mmu_idx, ptr_tag, bit55;
+    uint64_t ptr_last, ptr_end, prev_page, next_page;
+    uint64_t tag_first, tag_end;
+    uint64_t tag_byte_first, tag_byte_end;
+    uint32_t esize, total, tag_count, tag_size, n, c;
+    uint8_t *mem1, *mem2;
+    MMUAccessType type;
+
+    bit55 = extract64(ptr, 55, 1);
+
+    /* If TBI is disabled, the access is unchecked, and ptr is not dirty. */
+    if (unlikely(!tbi_check(desc, bit55))) {
+        return ptr;
+    }
+
+    ptr_tag = allocation_tag_from_addr(ptr);
+
+    if (tcma_check(desc, bit55, ptr_tag)) {
+        goto done;
+    }
+
+    mmu_idx = FIELD_EX32(desc, MTEDESC, MIDX);
+    type = FIELD_EX32(desc, MTEDESC, WRITE) ? MMU_DATA_STORE : MMU_DATA_LOAD;
+    esize = FIELD_EX32(desc, MTEDESC, ESIZE);
+    total = FIELD_EX32(desc, MTEDESC, TSIZE);
+
+    /* Find the addr of the end of the access, and of the last element. */
+    ptr_end = ptr + total;
+    ptr_last = ptr_end - esize;
+
+    /* Round the bounds to the tag granule, and compute the number of tags. */
+    tag_first = QEMU_ALIGN_DOWN(ptr, TAG_GRANULE);
+    tag_end = QEMU_ALIGN_UP(ptr_last, TAG_GRANULE);
+    tag_count = (tag_end - tag_first) / TAG_GRANULE;
+
+    /* Round the bounds to twice the tag granule, and compute the bytes. */
+    tag_byte_first = QEMU_ALIGN_DOWN(ptr, 2 * TAG_GRANULE);
+    tag_byte_end = QEMU_ALIGN_UP(ptr_last, 2 * TAG_GRANULE);
+
+    /* Locate the page boundaries. */
+    prev_page = ptr & TARGET_PAGE_MASK;
+    next_page = prev_page + TARGET_PAGE_SIZE;
+
+    if (likely(tag_end - prev_page <= TARGET_PAGE_SIZE)) {
+        /* Memory access stays on one page. */
+        tag_size = (tag_byte_end - tag_byte_first) / (2 * TAG_GRANULE);
+        mem1 = allocation_tag_mem(env, mmu_idx, ptr, type, total,
+                                  MMU_DATA_LOAD, tag_size, ra);
+        if (!mem1) {
+            goto done;
+        }
+        /* Perform all of the comparisons. */
+        n = checkN(mem1, ptr & TAG_GRANULE, ptr_tag, tag_count);
+    } else {
+        /* Memory access crosses to next page. */
+        tag_size = (next_page - tag_byte_first) / (2 * TAG_GRANULE);
+        mem1 = allocation_tag_mem(env, mmu_idx, ptr, type, next_page - ptr,
+                                  MMU_DATA_LOAD, tag_size, ra);
+
+        tag_size = (tag_byte_end - next_page) / (2 * TAG_GRANULE);
+        mem2 = allocation_tag_mem(env, mmu_idx, next_page, type,
+                                  ptr_end - next_page,
+                                  MMU_DATA_LOAD, tag_size, ra);
+
+        /*
+         * Perform all of the comparisons.
+         * Note the possible but unlikely case of the operation spanning
+         * two pages that do not both have tagging enabled.
+         */
+        n = c = (next_page - tag_first) / TAG_GRANULE;
+        if (mem1) {
+            n = checkN(mem1, ptr & TAG_GRANULE, ptr_tag, c);
+        }
+        if (n == c) {
+            if (!mem2) {
+                goto done;
+            }
+            n += checkN(mem2, 0, ptr_tag, tag_count - c);
+        }
+    }
+
+    /*
+     * If we failed, we know which granule.  Compute the element that
+     * is first in that granule, and signal failure on that element.
+     */
+    if (unlikely(n < tag_count)) {
+        uint64_t fail_ofs;
+
+        fail_ofs = tag_first + n * TAG_GRANULE - ptr;
+        fail_ofs = ROUND_UP(fail_ofs, esize);
+        mte_check_fail(env, mmu_idx, ptr + fail_ofs, ra);
+    }
+
+ done:
+    return useronly_clean_ptr(ptr);
+}
+
 uint64_t HELPER(mte_checkN)(CPUARMState *env, uint32_t desc, uint64_t ptr)
 {
-    return ptr;
+    return mte_checkN(env, desc, ptr, GETPC());
 }
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Use a special helper for DC_ZVA, rather than the more
general mte_checkN.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-28-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-a64.h    |   1 +
 target/arm/mte_helper.c    | 106 +++++++++++++++++++++++++++++++++++++
 target/arm/translate-a64.c |  16 +++++-
 3 files changed, 122 insertions(+), 1 deletion(-)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-29-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 61 +++++++++++++++++++++-----------------
 1 file changed, 33 insertions(+), 28 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static void do_ldr(DisasContext *s, uint32_t vofs, int len, int rn, int imm)
     int len_remain = len % 8;
     int nparts = len / 8 + ctpop8(len_remain);
     int midx = get_mem_index(s);
-    TCGv_i64 addr, t0, t1;
+    TCGv_i64 dirty_addr, clean_addr, t0, t1;
 
-    addr = tcg_temp_new_i64();
-    t0 = tcg_temp_new_i64();
+    dirty_addr = tcg_temp_new_i64();
+    tcg_gen_addi_i64(dirty_addr, cpu_reg_sp(s, rn), imm);
+    clean_addr = gen_mte_checkN(s, dirty_addr, false, rn != 31, len, MO_8);
+    tcg_temp_free_i64(dirty_addr);
 
-    /* Note that unpredicated load/store of vector/predicate registers
+    /*
+     * Note that unpredicated load/store of vector/predicate registers
      * are defined as a stream of bytes, which equates to little-endian
-     * operations on larger quantities.  There is no nice way to force
-     * a little-endian load for aarch64_be-linux-user out of line.
-     *
+     * operations on larger quantities.
      * Attempt to keep code expansion to a minimum by limiting the
      * amount of unrolling done.
      */
     if (nparts <= 4) {
         int i;
 
+        t0 = tcg_temp_new_i64();
         for (i = 0; i < len_align; i += 8) {
-            tcg_gen_addi_i64(addr, cpu_reg_sp(s, rn), imm + i);
-            tcg_gen_qemu_ld_i64(t0, addr, midx, MO_LEQ);
+            tcg_gen_qemu_ld_i64(t0, clean_addr, midx, MO_LEQ);
             tcg_gen_st_i64(t0, cpu_env, vofs + i);
+            tcg_gen_addi_i64(clean_addr, cpu_reg_sp(s, rn), 8);
         }
+        tcg_temp_free_i64(t0);
     } else {
         TCGLabel *loop = gen_new_label();
         TCGv_ptr tp, i = tcg_const_local_ptr(0);
 
+        /* Copy the clean address into a local temp, live across the loop. */
+        t0 = clean_addr;
+        clean_addr = tcg_temp_local_new_i64();
+        tcg_gen_mov_i64(clean_addr, t0);
+        tcg_temp_free_i64(t0);
+
         gen_set_label(loop);
 
-        /* Minimize the number of local temps that must be re-read from
-         * the stack each iteration.  Instead, re-compute values other
-         * than the loop counter.
-         */
+        t0 = tcg_temp_new_i64();
+        tcg_gen_qemu_ld_i64(t0, clean_addr, midx, MO_LEQ);
+        tcg_gen_addi_i64(clean_addr, clean_addr, 8);
+
         tp = tcg_temp_new_ptr();
-        tcg_gen_addi_ptr(tp, i, imm);
-        tcg_gen_extu_ptr_i64(addr, tp);
-        tcg_gen_add_i64(addr, addr, cpu_reg_sp(s, rn));
-
-        tcg_gen_qemu_ld_i64(t0, addr, midx, MO_LEQ);
-
         tcg_gen_add_ptr(tp, cpu_env, i);
         tcg_gen_addi_ptr(i, i, 8);
         tcg_gen_st_i64(t0, tp, vofs);
         tcg_temp_free_ptr(tp);
+        tcg_temp_free_i64(t0);
 
         tcg_gen_brcondi_ptr(TCG_COND_LTU, i, len_align, loop);
         tcg_temp_free_ptr(i);
     }
 
-    /* Predicate register loads can be any multiple of 2.
+    /*
+     * Predicate register loads can be any multiple of 2.
      * Note that we still store the entire 64-bit unit into cpu_env.
      */
     if (len_remain) {
-        tcg_gen_addi_i64(addr, cpu_reg_sp(s, rn), imm + len_align);
-
+        t0 = tcg_temp_new_i64();
         switch (len_remain) {
         case 2:
         case 4:
         case 8:
-            tcg_gen_qemu_ld_i64(t0, addr, midx, MO_LE | ctz32(len_remain));
+            tcg_gen_qemu_ld_i64(t0, clean_addr, midx,
+                                MO_LE | ctz32(len_remain));
             break;
 
         case 6:
             t1 = tcg_temp_new_i64();
-            tcg_gen_qemu_ld_i64(t0, addr, midx, MO_LEUL);
-            tcg_gen_addi_i64(addr, addr, 4);
-            tcg_gen_qemu_ld_i64(t1, addr, midx, MO_LEUW);
+            tcg_gen_qemu_ld_i64(t0, clean_addr, midx, MO_LEUL);
+            tcg_gen_addi_i64(clean_addr, clean_addr, 4);
+            tcg_gen_qemu_ld_i64(t1, clean_addr, midx, MO_LEUW);
             tcg_gen_deposit_i64(t0, t0, t1, 32, 32);
             tcg_temp_free_i64(t1);
             break;
@@ -XXX,XX +XXX,XX @@ static void do_ldr(DisasContext *s, uint32_t vofs, int len, int rn, int imm)
             g_assert_not_reached();
         }
         tcg_gen_st_i64(t0, cpu_env, vofs + len_align);
+        tcg_temp_free_i64(t0);
     }
-    tcg_temp_free_i64(addr);
-    tcg_temp_free_i64(t0);
+    tcg_temp_free_i64(clean_addr);
 }
 
 /* Similarly for stores.  */
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-30-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 61 +++++++++++++++++++++-----------------
 1 file changed, 33 insertions(+), 28 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static void do_str(DisasContext *s, uint32_t vofs, int len, int rn, int imm)
     int len_remain = len % 8;
     int nparts = len / 8 + ctpop8(len_remain);
     int midx = get_mem_index(s);
-    TCGv_i64 addr, t0;
+    TCGv_i64 dirty_addr, clean_addr, t0;
 
-    addr = tcg_temp_new_i64();
-    t0 = tcg_temp_new_i64();
+    dirty_addr = tcg_temp_new_i64();
+    tcg_gen_addi_i64(dirty_addr, cpu_reg_sp(s, rn), imm);
+    clean_addr = gen_mte_checkN(s, dirty_addr, false, rn != 31, len, MO_8);
+    tcg_temp_free_i64(dirty_addr);
 
     /* Note that unpredicated load/store of vector/predicate registers
      * are defined as a stream of bytes, which equates to little-endian
@@ -XXX,XX +XXX,XX @@ static void do_str(DisasContext *s, uint32_t vofs, int len, int rn, int imm)
     if (nparts <= 4) {
         int i;
 
+        t0 = tcg_temp_new_i64();
         for (i = 0; i < len_align; i += 8) {
             tcg_gen_ld_i64(t0, cpu_env, vofs + i);
-            tcg_gen_addi_i64(addr, cpu_reg_sp(s, rn), imm + i);
-            tcg_gen_qemu_st_i64(t0, addr, midx, MO_LEQ);
+            tcg_gen_qemu_st_i64(t0, clean_addr, midx, MO_LEQ);
+            tcg_gen_addi_i64(clean_addr, cpu_reg_sp(s, rn), 8);
         }
+        tcg_temp_free_i64(t0);
     } else {
         TCGLabel *loop = gen_new_label();
-        TCGv_ptr t2, i = tcg_const_local_ptr(0);
+        TCGv_ptr tp, i = tcg_const_local_ptr(0);
+
+        /* Copy the clean address into a local temp, live across the loop. */
+        t0 = clean_addr;
+        clean_addr = tcg_temp_local_new_i64();
+        tcg_gen_mov_i64(clean_addr, t0);
+        tcg_temp_free_i64(t0);
 
         gen_set_label(loop);
 
-        t2 = tcg_temp_new_ptr();
-        tcg_gen_add_ptr(t2, cpu_env, i);
-        tcg_gen_ld_i64(t0, t2, vofs);
-
-        /* Minimize the number of local temps that must be re-read from
-         * the stack each iteration.  Instead, re-compute values other
-         * than the loop counter.
-         */
-        tcg_gen_addi_ptr(t2, i, imm);
-        tcg_gen_extu_ptr_i64(addr, t2);
-        tcg_gen_add_i64(addr, addr, cpu_reg_sp(s, rn));
-        tcg_temp_free_ptr(t2);
-
-        tcg_gen_qemu_st_i64(t0, addr, midx, MO_LEQ);
-
+        t0 = tcg_temp_new_i64();
+        tp = tcg_temp_new_ptr();
+        tcg_gen_add_ptr(tp, cpu_env, i);
+        tcg_gen_ld_i64(t0, tp, vofs);
         tcg_gen_addi_ptr(i, i, 8);
+        tcg_temp_free_ptr(tp);
+
+        tcg_gen_qemu_st_i64(t0, clean_addr, midx, MO_LEQ);
+        tcg_gen_addi_i64(clean_addr, clean_addr, 8);
+        tcg_temp_free_i64(t0);
 
         tcg_gen_brcondi_ptr(TCG_COND_LTU, i, len_align, loop);
         tcg_temp_free_ptr(i);
@@ -XXX,XX +XXX,XX @@ static void do_str(DisasContext *s, uint32_t vofs, int len, int rn, int imm)
 
     /* Predicate register stores can be any multiple of 2.  */
     if (len_remain) {
+        t0 = tcg_temp_new_i64();
         tcg_gen_ld_i64(t0, cpu_env, vofs + len_align);
-        tcg_gen_addi_i64(addr, cpu_reg_sp(s, rn), imm + len_align);
 
         switch (len_remain) {
         case 2:
         case 4:
         case 8:
-            tcg_gen_qemu_st_i64(t0, addr, midx, MO_LE | ctz32(len_remain));
+            tcg_gen_qemu_st_i64(t0, clean_addr, midx,
+                                MO_LE | ctz32(len_remain));
             break;
 
         case 6:
-            tcg_gen_qemu_st_i64(t0, addr, midx, MO_LEUL);
-            tcg_gen_addi_i64(addr, addr, 4);
+            tcg_gen_qemu_st_i64(t0, clean_addr, midx, MO_LEUL);
+            tcg_gen_addi_i64(clean_addr, clean_addr, 4);
             tcg_gen_shri_i64(t0, t0, 32);
-            tcg_gen_qemu_st_i64(t0, addr, midx, MO_LEUW);
+            tcg_gen_qemu_st_i64(t0, clean_addr, midx, MO_LEUW);
             break;
 
         default:
             g_assert_not_reached();
         }
+        tcg_temp_free_i64(t0);
     }
-    tcg_temp_free_i64(addr);
-    tcg_temp_free_i64(t0);
+    tcg_temp_free_i64(clean_addr);
 }
 
 static bool trans_LDR_zri(DisasContext *s, arg_rri *a)
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-31-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 6 ++++--
 1 file changed, 4 insertions(+), 2 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_LD1R_zpri(DisasContext *s, arg_rpri_load *a)
     unsigned esz = dtype_esz[a->dtype];
     unsigned msz = dtype_msz(a->dtype);
     TCGLabel *over = gen_new_label();
-    TCGv_i64 temp;
+    TCGv_i64 temp, clean_addr;
 
     /* If the guarding predicate has no bits set, no load occurs.  */
     if (psz <= 8) {
@@ -XXX,XX +XXX,XX @@ static bool trans_LD1R_zpri(DisasContext *s, arg_rpri_load *a)
     /* Load the data.  */
     temp = tcg_temp_new_i64();
     tcg_gen_addi_i64(temp, cpu_reg_sp(s, a->rn), a->imm << msz);
-    tcg_gen_qemu_ld_i64(temp, temp, get_mem_index(s),
+    clean_addr = gen_mte_check1(s, temp, false, true, msz);
+
+    tcg_gen_qemu_ld_i64(temp, clean_addr, get_mem_index(s),
                         s->be_data | dtype_mop[a->dtype]);
 
     /* Broadcast to *all* elements.  */
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Move the variable declarations to the top of the function,
but do not create a new label before sve_access_check.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-32-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 12 +++++++-----
 1 file changed, 7 insertions(+), 5 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_LD1RQ_zpri(DisasContext *s, arg_rpri_load *a)
 /* Load and broadcast element.  */
 static bool trans_LD1R_zpri(DisasContext *s, arg_rpri_load *a)
 {
-    if (!sve_access_check(s)) {
-        return true;
-    }
-
     unsigned vsz = vec_full_reg_size(s);
     unsigned psz = pred_full_reg_size(s);
     unsigned esz = dtype_esz[a->dtype];
     unsigned msz = dtype_msz(a->dtype);
-    TCGLabel *over = gen_new_label();
+    TCGLabel *over;
     TCGv_i64 temp, clean_addr;
 
+    if (!sve_access_check(s)) {
+        return true;
+    }
+
+    over = gen_new_label();
+
     /* If the guarding predicate has no bits set, no load occurs.  */
     if (psz <= 8) {
         /* Reduce the pred_esz_masks value simply to reduce the
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Introduce an lvalue macro to wrap target_tlb_bit0.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-33-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h           | 13 +++++++++++++
 target/arm/helper.c        |  2 +-
 target/arm/translate-a64.c |  2 +-
 3 files changed, 15 insertions(+), 2 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ static inline uint64_t *aa64_vfp_qreg(CPUARMState *env, unsigned regno)
 /* Shared between translate-sve.c and sve_helper.c.  */
 extern const uint64_t pred_esz_masks[4];
 
+/* Helper for the macros below, validating the argument type. */
+static inline MemTxAttrs *typecheck_memtxattrs(MemTxAttrs *x)
+{
+    return x;
+}
+
+/*
+ * Lvalue macros for ARM TLB bits that we must cache in the TCG TLB.
+ * Using these should be a bit more self-documenting than using the
+ * generic target bits directly.
+ */
+#define arm_tlb_bti_gp(x) (typecheck_memtxattrs(x)->target_tlb_bit0)
+
 /*
  * Naming convention for isar_feature functions:
  * Functions which test 32-bit ID registers should have _aa32_ in
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static bool get_phys_addr_lpae(CPUARMState *env, target_ulong address,
     }
     /* When in aarch64 mode, and BTI is enabled, remember GP in the IOTLB.  */
     if (aarch64 && guarded && cpu_isar_feature(aa64_bti, cpu)) {
-        txattrs->target_tlb_bit0 = true;
+        arm_tlb_bti_gp(txattrs) = true;
     }
 
     if (cacheattrs != NULL) {
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static bool is_guarded_page(CPUARMState *env, DisasContext *s)
      * table entry even for that case.
      */
     return (tlb_hit(entry->addr_code, addr) &&
-            env_tlb(env)->d[mmu_idx].iotlb[index].attrs.target_tlb_bit0);
+            arm_tlb_bti_gp(&env_tlb(env)->d[mmu_idx].iotlb[index].attrs));
 #endif
 }
 
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Because the elements are sequential, we can eliminate many tests all
at once when the tag hits TCMA, or if the page(s) are not Tagged.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-34-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h           |   1 +
 target/arm/helper-sve.h    |  58 ++++++++++
 target/arm/internals.h     |   6 +
 target/arm/sve_helper.c    | 218 ++++++++++++++++++++++++++++++-------
 target/arm/translate-sve.c | 186 ++++++++++++++++++++++---------
 5 files changed, 378 insertions(+), 91 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ static inline MemTxAttrs *typecheck_memtxattrs(MemTxAttrs *x)
  * generic target bits directly.
  */
 #define arm_tlb_bti_gp(x) (typecheck_memtxattrs(x)->target_tlb_bit0)
+#define arm_tlb_mte_tagged(x) (typecheck_memtxattrs(x)->target_tlb_bit1)
 
 /*
  * Naming convention for isar_feature functions:
diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper-sve.h
+++ b/target/arm/helper-sve.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_4(sve_ld1sds_le_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 DEF_HELPER_FLAGS_4(sve_ld1sdu_be_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 DEF_HELPER_FLAGS_4(sve_ld1sds_be_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 
+DEF_HELPER_FLAGS_4(sve_ld1bb_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld2bb_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld3bb_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld4bb_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1hh_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld2hh_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld3hh_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld4hh_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1hh_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld2hh_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld3hh_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld4hh_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1ss_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld2ss_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld3ss_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld4ss_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1ss_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld2ss_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld3ss_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld4ss_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1dd_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld2dd_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld3dd_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld4dd_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1dd_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld2dd_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld3dd_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld4dd_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1bhu_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1bsu_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1bdu_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1bhs_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1bss_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1bds_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1hsu_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1hdu_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1hss_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1hds_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1hsu_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1hdu_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1hss_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1hds_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1sdu_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1sds_le_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1sdu_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1sds_be_r_mte, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
 DEF_HELPER_FLAGS_4(sve_ldff1bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 DEF_HELPER_FLAGS_4(sve_ldff1bhu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 DEF_HELPER_FLAGS_4(sve_ldff1bsu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ void arm_log_exception(int idx);
 #define LOG2_TAG_GRANULE 4
 #define TAG_GRANULE      (1 << LOG2_TAG_GRANULE)
 
+/*
+ * The SVE simd_data field, for memory ops, contains either
+ * rd (5 bits) or a shift count (2 bits).
+ */
+#define SVE_MTEDESC_SHIFT 5
+
 /* Bits within a descriptor passed to the helper_mte_check* functions. */
 FIELD(MTEDESC, MIDX,  0, 4)
 FIELD(MTEDESC, TBI,   4, 2)
diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve_helper.c
+++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ static void sve_cont_ldst_watchpoints(SVEContLdSt *info, CPUARMState *env,
 #endif
 }
 
+typedef uint64_t mte_check_fn(CPUARMState *, uint32_t, uint64_t, uintptr_t);
+
+static inline QEMU_ALWAYS_INLINE
+void sve_cont_ldst_mte_check_int(SVEContLdSt *info, CPUARMState *env,
+                                 uint64_t *vg, target_ulong addr, int esize,
+                                 int msize, uint32_t mtedesc, uintptr_t ra,
+                                 mte_check_fn *check)
+{
+    intptr_t mem_off, reg_off, reg_last;
+
+    /* Process the page only if MemAttr == Tagged. */
+    if (arm_tlb_mte_tagged(&info->page[0].attrs)) {
+        mem_off = info->mem_off_first[0];
+        reg_off = info->reg_off_first[0];
+        reg_last = info->reg_off_split;
+        if (reg_last < 0) {
+            reg_last = info->reg_off_last[0];
+        }
+
+        do {
+            uint64_t pg = vg[reg_off >> 6];
+            do {
+                if ((pg >> (reg_off & 63)) & 1) {
+                    check(env, mtedesc, addr, ra);
+                }
+                reg_off += esize;
+                mem_off += msize;
+            } while (reg_off <= reg_last && (reg_off & 63));
+        } while (reg_off <= reg_last);
+    }
+
+    mem_off = info->mem_off_first[1];
+    if (mem_off >= 0 && arm_tlb_mte_tagged(&info->page[1].attrs)) {
+        reg_off = info->reg_off_first[1];
+        reg_last = info->reg_off_last[1];
+
+        do {
+            uint64_t pg = vg[reg_off >> 6];
+            do {
+                if ((pg >> (reg_off & 63)) & 1) {
+                    check(env, mtedesc, addr, ra);
+                }
+                reg_off += esize;
+                mem_off += msize;
+            } while (reg_off & 63);
+        } while (reg_off <= reg_last);
+    }
+}
+
+typedef void sve_cont_ldst_mte_check_fn(SVEContLdSt *info, CPUARMState *env,
+                                        uint64_t *vg, target_ulong addr,
+                                        int esize, int msize, uint32_t mtedesc,
+                                        uintptr_t ra);
+
+static void sve_cont_ldst_mte_check1(SVEContLdSt *info, CPUARMState *env,
+                                     uint64_t *vg, target_ulong addr,
+                                     int esize, int msize, uint32_t mtedesc,
+                                     uintptr_t ra)
+{
+    sve_cont_ldst_mte_check_int(info, env, vg, addr, esize, msize,
+                                mtedesc, ra, mte_check1);
+}
+
+static void sve_cont_ldst_mte_checkN(SVEContLdSt *info, CPUARMState *env,
+                                     uint64_t *vg, target_ulong addr,
+                                     int esize, int msize, uint32_t mtedesc,
+                                     uintptr_t ra)
+{
+    sve_cont_ldst_mte_check_int(info, env, vg, addr, esize, msize,
+                                mtedesc, ra, mte_checkN);
+}
+
+
 /*
  * Common helper for all contiguous 1,2,3,4-register predicated stores.
  */
 static inline QEMU_ALWAYS_INLINE
 void sve_ldN_r(CPUARMState *env, uint64_t *vg, const target_ulong addr,
                uint32_t desc, const uintptr_t retaddr,
-               const int esz, const int msz, const int N,
+               const int esz, const int msz, const int N, uint32_t mtedesc,
                sve_ldst1_host_fn *host_fn,
-               sve_ldst1_tlb_fn *tlb_fn)
+               sve_ldst1_tlb_fn *tlb_fn,
+               sve_cont_ldst_mte_check_fn *mte_check_fn)
 {
     const unsigned rd = simd_data(desc);
     const intptr_t reg_max = simd_oprsz(desc);
@@ -XXX,XX +XXX,XX @@ void sve_ldN_r(CPUARMState *env, uint64_t *vg, const target_ulong addr,
     sve_cont_ldst_watchpoints(&info, env, vg, addr, 1 << esz, N << msz,
                               BP_MEM_READ, retaddr);
 
-    /* TODO: MTE check. */
+    /*
+     * Handle mte checks for all active elements.
+     * Since TBI must be set for MTE, !mtedesc => !mte_active.
+     */
+    if (mte_check_fn && mtedesc) {
+        mte_check_fn(&info, env, vg, addr, 1 << esz, N << msz,
+                     mtedesc, retaddr);
+    }
 
     flags = info.page[0].flags | info.page[1].flags;
     if (unlikely(flags != 0)) {
@@ -XXX,XX +XXX,XX @@ void sve_ldN_r(CPUARMState *env, uint64_t *vg, const target_ulong addr,
     }
 }
 
-#define DO_LD1_1(NAME, ESZ) \
-void HELPER(sve_##NAME##_r)(CPUARMState *env, void *vg,        \
-                            target_ulong addr, uint32_t desc)  \
-{                                                              \
-    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, MO_8, 1,      \
-              sve_##NAME##_host, sve_##NAME##_tlb);            \
+static inline QEMU_ALWAYS_INLINE
+void sve_ldN_r_mte(CPUARMState *env, uint64_t *vg, target_ulong addr,
+                   uint32_t desc, const uintptr_t ra,
+                   const int esz, const int msz, const int N,
+                   sve_ldst1_host_fn *host_fn,
+                   sve_ldst1_tlb_fn *tlb_fn)
+{
+    uint32_t mtedesc = desc >> (SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
+    int bit55 = extract64(addr, 55, 1);
+
+    /* Remove mtedesc from the normal sve descriptor. */
+    desc = extract32(desc, 0, SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
+
+    /* Perform gross MTE suppression early. */
+    if (!tbi_check(desc, bit55) ||
+        tcma_check(desc, bit55, allocation_tag_from_addr(addr))) {
+        mtedesc = 0;
+    }
+
+    sve_ldN_r(env, vg, addr, desc, ra, esz, msz, N, mtedesc, host_fn, tlb_fn,
+              N == 1 ? sve_cont_ldst_mte_check1 : sve_cont_ldst_mte_checkN);
 }
 
-#define DO_LD1_2(NAME, ESZ, MSZ) \
-void HELPER(sve_##NAME##_le_r)(CPUARMState *env, void *vg,        \
-                               target_ulong addr, uint32_t desc)  \
-{                                                                 \
-    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, MSZ, 1,          \
-              sve_##NAME##_le_host, sve_##NAME##_le_tlb);         \
-}                                                                 \
-void HELPER(sve_##NAME##_be_r)(CPUARMState *env, void *vg,        \
-                               target_ulong addr, uint32_t desc)  \
-{                                                                 \
-    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, MSZ, 1,          \
-              sve_##NAME##_be_host, sve_##NAME##_be_tlb);         \
+#define DO_LD1_1(NAME, ESZ)                                             \
+void HELPER(sve_##NAME##_r)(CPUARMState *env, void *vg,                 \
+                            target_ulong addr, uint32_t desc)           \
+{                                                                       \
+    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, MO_8, 1, 0,            \
+              sve_##NAME##_host, sve_##NAME##_tlb, NULL);               \
+}                                                                       \
+void HELPER(sve_##NAME##_r_mte)(CPUARMState *env, void *vg,             \
+                                target_ulong addr, uint32_t desc)       \
+{                                                                       \
+    sve_ldN_r_mte(env, vg, addr, desc, GETPC(), ESZ, MO_8, 1,           \
+                  sve_##NAME##_host, sve_##NAME##_tlb);                 \
+}
+
+#define DO_LD1_2(NAME, ESZ, MSZ)                                        \
+void HELPER(sve_##NAME##_le_r)(CPUARMState *env, void *vg,              \
+                               target_ulong addr, uint32_t desc)        \
+{                                                                       \
+    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, MSZ, 1, 0,             \
+              sve_##NAME##_le_host, sve_##NAME##_le_tlb, NULL);         \
+}                                                                       \
+void HELPER(sve_##NAME##_be_r)(CPUARMState *env, void *vg,              \
+                               target_ulong addr, uint32_t desc)        \
+{                                                                       \
+    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, MSZ, 1, 0,             \
+              sve_##NAME##_be_host, sve_##NAME##_be_tlb, NULL);         \
+}                                                                       \
+void HELPER(sve_##NAME##_le_r_mte)(CPUARMState *env, void *vg,          \
+                                 target_ulong addr, uint32_t desc)      \
+{                                                                       \
+    sve_ldN_r_mte(env, vg, addr, desc, GETPC(), ESZ, MSZ, 1,            \
+                  sve_##NAME##_le_host, sve_##NAME##_le_tlb);           \
+}                                                                       \
+void HELPER(sve_##NAME##_be_r_mte)(CPUARMState *env, void *vg,          \
+                                 target_ulong addr, uint32_t desc)      \
+{                                                                       \
+    sve_ldN_r_mte(env, vg, addr, desc, GETPC(), ESZ, MSZ, 1,            \
+                  sve_##NAME##_be_host, sve_##NAME##_be_tlb);           \
 }
 
 DO_LD1_1(ld1bb,  MO_8)
@@ -XXX,XX +XXX,XX @@ DO_LD1_2(ld1dd,  MO_64, MO_64)
 #undef DO_LD1_1
 #undef DO_LD1_2
 
-#define DO_LDN_1(N) \
-void HELPER(sve_ld##N##bb_r)(CPUARMState *env, void *vg,        \
-                             target_ulong addr, uint32_t desc)  \
-{                                                               \
-    sve_ldN_r(env, vg, addr, desc, GETPC(), MO_8, MO_8, N,      \
-              sve_ld1bb_host, sve_ld1bb_tlb);                   \
+#define DO_LDN_1(N)                                                     \
+void HELPER(sve_ld##N##bb_r)(CPUARMState *env, void *vg,                \
+                             target_ulong addr, uint32_t desc)          \
+{                                                                       \
+    sve_ldN_r(env, vg, addr, desc, GETPC(), MO_8, MO_8, N, 0,           \
+              sve_ld1bb_host, sve_ld1bb_tlb, NULL);                     \
+}                                                                       \
+void HELPER(sve_ld##N##bb_r_mte)(CPUARMState *env, void *vg,            \
+                                 target_ulong addr, uint32_t desc)      \
+{                                                                       \
+    sve_ldN_r_mte(env, vg, addr, desc, GETPC(), MO_8, MO_8, N,          \
+                  sve_ld1bb_host, sve_ld1bb_tlb);                       \
 }
 
-#define DO_LDN_2(N, SUFF, ESZ) \
-void HELPER(sve_ld##N##SUFF##_le_r)(CPUARMState *env, void *vg,       \
-                                    target_ulong addr, uint32_t desc) \
-{                                                                     \
-    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, ESZ, N,              \
-              sve_ld1##SUFF##_le_host, sve_ld1##SUFF##_le_tlb);       \
-}                                                                     \
-void HELPER(sve_ld##N##SUFF##_be_r)(CPUARMState *env, void *vg,       \
-                                    target_ulong addr, uint32_t desc) \
-{                                                                     \
-    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, ESZ, N,              \
-              sve_ld1##SUFF##_be_host, sve_ld1##SUFF##_be_tlb);       \
+#define DO_LDN_2(N, SUFF, ESZ)                                          \
+void HELPER(sve_ld##N##SUFF##_le_r)(CPUARMState *env, void *vg,         \
+                                    target_ulong addr, uint32_t desc)   \
+{                                                                       \
+    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, ESZ, N, 0,             \
+              sve_ld1##SUFF##_le_host, sve_ld1##SUFF##_le_tlb, NULL);   \
+}                                                                       \
+void HELPER(sve_ld##N##SUFF##_be_r)(CPUARMState *env, void *vg,         \
+                                    target_ulong addr, uint32_t desc)   \
+{                                                                       \
+    sve_ldN_r(env, vg, addr, desc, GETPC(), ESZ, ESZ, N, 0,             \
+              sve_ld1##SUFF##_be_host, sve_ld1##SUFF##_be_tlb, NULL);   \
+}                                                                       \
+void HELPER(sve_ld##N##SUFF##_le_r_mte)(CPUARMState *env, void *vg,     \
+                                        target_ulong addr, uint32_t desc) \
+{                                                                       \
+    sve_ldN_r_mte(env, vg, addr, desc, GETPC(), ESZ, ESZ, N,            \
+                  sve_ld1##SUFF##_le_host, sve_ld1##SUFF##_le_tlb);     \
+}                                                                       \
+void HELPER(sve_ld##N##SUFF##_be_r_mte)(CPUARMState *env, void *vg,     \
+                                        target_ulong addr, uint32_t desc) \
+{                                                                       \
+    sve_ldN_r_mte(env, vg, addr, desc, GETPC(), ESZ, ESZ, N,            \
+                  sve_ld1##SUFF##_be_host, sve_ld1##SUFF##_be_tlb);     \
 }
 
 DO_LDN_1(2)
diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static const uint8_t dtype_esz[16] = {
 };
 
 static void do_mem_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
-                       int dtype, gen_helper_gvec_mem *fn)
+                       int dtype, uint32_t mte_n, bool is_write,
+                       gen_helper_gvec_mem *fn)
 {
     unsigned vsz = vec_full_reg_size(s);
     TCGv_ptr t_pg;
     TCGv_i32 t_desc;
-    int desc;
+    int desc = 0;
 
-    /* For e.g. LD4, there are not enough arguments to pass all 4
+    /*
+     * For e.g. LD4, there are not enough arguments to pass all 4
      * registers as pointers, so encode the regno into the data field.
      * For consistency, do this even for LD1.
+     * TODO: mte_n check here while callers are updated.
      */
-    desc = simd_desc(vsz, vsz, zt);
+    if (mte_n && s->mte_active[0]) {
+        int msz = dtype_msz(dtype);
+
+        desc = FIELD_DP32(desc, MTEDESC, MIDX, get_mem_index(s));
+        desc = FIELD_DP32(desc, MTEDESC, TBI, s->tbid);
+        desc = FIELD_DP32(desc, MTEDESC, TCMA, s->tcma);
+        desc = FIELD_DP32(desc, MTEDESC, WRITE, is_write);
+        desc = FIELD_DP32(desc, MTEDESC, ESIZE, 1 << msz);
+        desc = FIELD_DP32(desc, MTEDESC, TSIZE, mte_n << msz);
+        desc <<= SVE_MTEDESC_SHIFT;
+    }
+    desc = simd_desc(vsz, vsz, zt | desc);
     t_desc = tcg_const_i32(desc);
     t_pg = tcg_temp_new_ptr();
 
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
 static void do_ld_zpa(DisasContext *s, int zt, int pg,
                       TCGv_i64 addr, int dtype, int nreg)
 {
-    static gen_helper_gvec_mem * const fns[2][16][4] = {
-        /* Little-endian */
-        { { gen_helper_sve_ld1bb_r, gen_helper_sve_ld2bb_r,
+    static gen_helper_gvec_mem * const fns[2][2][16][4] = {
+        { /* mte inactive, little-endian */
+          { { gen_helper_sve_ld1bb_r, gen_helper_sve_ld2bb_r,
             gen_helper_sve_ld3bb_r, gen_helper_sve_ld4bb_r },
-          { gen_helper_sve_ld1bhu_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1bsu_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1bdu_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1bhu_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1bsu_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1bdu_r, NULL, NULL, NULL },
 
-          { gen_helper_sve_ld1sds_le_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1hh_le_r, gen_helper_sve_ld2hh_le_r,
-            gen_helper_sve_ld3hh_le_r, gen_helper_sve_ld4hh_le_r },
-          { gen_helper_sve_ld1hsu_le_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1hdu_le_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1sds_le_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1hh_le_r, gen_helper_sve_ld2hh_le_r,
+              gen_helper_sve_ld3hh_le_r, gen_helper_sve_ld4hh_le_r },
+            { gen_helper_sve_ld1hsu_le_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1hdu_le_r, NULL, NULL, NULL },
 
-          { gen_helper_sve_ld1hds_le_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1hss_le_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1ss_le_r, gen_helper_sve_ld2ss_le_r,
-            gen_helper_sve_ld3ss_le_r, gen_helper_sve_ld4ss_le_r },
-          { gen_helper_sve_ld1sdu_le_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1hds_le_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1hss_le_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1ss_le_r, gen_helper_sve_ld2ss_le_r,
+              gen_helper_sve_ld3ss_le_r, gen_helper_sve_ld4ss_le_r },
+            { gen_helper_sve_ld1sdu_le_r, NULL, NULL, NULL },
 
-          { gen_helper_sve_ld1bds_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1bss_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1bhs_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1dd_le_r, gen_helper_sve_ld2dd_le_r,
-            gen_helper_sve_ld3dd_le_r, gen_helper_sve_ld4dd_le_r } },
+            { gen_helper_sve_ld1bds_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1bss_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1bhs_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1dd_le_r, gen_helper_sve_ld2dd_le_r,
+              gen_helper_sve_ld3dd_le_r, gen_helper_sve_ld4dd_le_r } },
 
-        /* Big-endian */
-        { { gen_helper_sve_ld1bb_r, gen_helper_sve_ld2bb_r,
-            gen_helper_sve_ld3bb_r, gen_helper_sve_ld4bb_r },
-          { gen_helper_sve_ld1bhu_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1bsu_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1bdu_r, NULL, NULL, NULL },
+          /* mte inactive, big-endian */
+          { { gen_helper_sve_ld1bb_r, gen_helper_sve_ld2bb_r,
+              gen_helper_sve_ld3bb_r, gen_helper_sve_ld4bb_r },
+            { gen_helper_sve_ld1bhu_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1bsu_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1bdu_r, NULL, NULL, NULL },
 
-          { gen_helper_sve_ld1sds_be_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1hh_be_r, gen_helper_sve_ld2hh_be_r,
-            gen_helper_sve_ld3hh_be_r, gen_helper_sve_ld4hh_be_r },
-          { gen_helper_sve_ld1hsu_be_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1hdu_be_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1sds_be_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1hh_be_r, gen_helper_sve_ld2hh_be_r,
+              gen_helper_sve_ld3hh_be_r, gen_helper_sve_ld4hh_be_r },
+            { gen_helper_sve_ld1hsu_be_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1hdu_be_r, NULL, NULL, NULL },
 
-          { gen_helper_sve_ld1hds_be_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1hss_be_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1ss_be_r, gen_helper_sve_ld2ss_be_r,
-            gen_helper_sve_ld3ss_be_r, gen_helper_sve_ld4ss_be_r },
-          { gen_helper_sve_ld1sdu_be_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1hds_be_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1hss_be_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1ss_be_r, gen_helper_sve_ld2ss_be_r,
+              gen_helper_sve_ld3ss_be_r, gen_helper_sve_ld4ss_be_r },
+            { gen_helper_sve_ld1sdu_be_r, NULL, NULL, NULL },
 
-          { gen_helper_sve_ld1bds_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1bss_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1bhs_r, NULL, NULL, NULL },
-          { gen_helper_sve_ld1dd_be_r, gen_helper_sve_ld2dd_be_r,
-            gen_helper_sve_ld3dd_be_r, gen_helper_sve_ld4dd_be_r } }
+            { gen_helper_sve_ld1bds_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1bss_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1bhs_r, NULL, NULL, NULL },
+            { gen_helper_sve_ld1dd_be_r, gen_helper_sve_ld2dd_be_r,
+              gen_helper_sve_ld3dd_be_r, gen_helper_sve_ld4dd_be_r } } },
+
+        { /* mte active, little-endian */
+          { { gen_helper_sve_ld1bb_r_mte,
+              gen_helper_sve_ld2bb_r_mte,
+              gen_helper_sve_ld3bb_r_mte,
+              gen_helper_sve_ld4bb_r_mte },
+            { gen_helper_sve_ld1bhu_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1bsu_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1bdu_r_mte, NULL, NULL, NULL },
+
+            { gen_helper_sve_ld1sds_le_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1hh_le_r_mte,
+              gen_helper_sve_ld2hh_le_r_mte,
+              gen_helper_sve_ld3hh_le_r_mte,
+              gen_helper_sve_ld4hh_le_r_mte },
+            { gen_helper_sve_ld1hsu_le_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1hdu_le_r_mte, NULL, NULL, NULL },
+
+            { gen_helper_sve_ld1hds_le_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1hss_le_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1ss_le_r_mte,
+              gen_helper_sve_ld2ss_le_r_mte,
+              gen_helper_sve_ld3ss_le_r_mte,
+              gen_helper_sve_ld4ss_le_r_mte },
+            { gen_helper_sve_ld1sdu_le_r_mte, NULL, NULL, NULL },
+
+            { gen_helper_sve_ld1bds_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1bss_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1bhs_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1dd_le_r_mte,
+              gen_helper_sve_ld2dd_le_r_mte,
+              gen_helper_sve_ld3dd_le_r_mte,
+              gen_helper_sve_ld4dd_le_r_mte } },
+
+          /* mte active, big-endian */
+          { { gen_helper_sve_ld1bb_r_mte,
+              gen_helper_sve_ld2bb_r_mte,
+              gen_helper_sve_ld3bb_r_mte,
+              gen_helper_sve_ld4bb_r_mte },
+            { gen_helper_sve_ld1bhu_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1bsu_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1bdu_r_mte, NULL, NULL, NULL },
+
+            { gen_helper_sve_ld1sds_be_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1hh_be_r_mte,
+              gen_helper_sve_ld2hh_be_r_mte,
+              gen_helper_sve_ld3hh_be_r_mte,
+              gen_helper_sve_ld4hh_be_r_mte },
+            { gen_helper_sve_ld1hsu_be_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1hdu_be_r_mte, NULL, NULL, NULL },
+
+            { gen_helper_sve_ld1hds_be_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1hss_be_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1ss_be_r_mte,
+              gen_helper_sve_ld2ss_be_r_mte,
+              gen_helper_sve_ld3ss_be_r_mte,
+              gen_helper_sve_ld4ss_be_r_mte },
+            { gen_helper_sve_ld1sdu_be_r_mte, NULL, NULL, NULL },
+
+            { gen_helper_sve_ld1bds_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1bss_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1bhs_r_mte, NULL, NULL, NULL },
+            { gen_helper_sve_ld1dd_be_r_mte,
+              gen_helper_sve_ld2dd_be_r_mte,
+              gen_helper_sve_ld3dd_be_r_mte,
+              gen_helper_sve_ld4dd_be_r_mte } } },
     };
-    gen_helper_gvec_mem *fn = fns[s->be_data == MO_BE][dtype][nreg];
+    gen_helper_gvec_mem *fn
+        = fns[s->mte_active[0]][s->be_data == MO_BE][dtype][nreg];
 
-    /* While there are holes in the table, they are not
+    /*
+     * While there are holes in the table, they are not
      * accessible via the instruction encoding.
      */
     assert(fn != NULL);
-    do_mem_zpa(s, zt, pg, addr, dtype, fn);
+    do_mem_zpa(s, zt, pg, addr, dtype, nreg, false, fn);
 }
 
 static bool trans_LD_zprr(DisasContext *s, arg_rprr_load *a)
@@ -XXX,XX +XXX,XX @@ static bool trans_LDFF1_zprr(DisasContext *s, arg_rprr_load *a)
         TCGv_i64 addr = new_tmp_a64(s);
         tcg_gen_shli_i64(addr, cpu_reg(s, a->rm), dtype_msz(a->dtype));
         tcg_gen_add_i64(addr, addr, cpu_reg_sp(s, a->rn));
-        do_mem_zpa(s, a->rd, a->pg, addr, a->dtype,
+        do_mem_zpa(s, a->rd, a->pg, addr, a->dtype, 0, false,
                    fns[s->be_data == MO_BE][a->dtype]);
     }
     return true;
@@ -XXX,XX +XXX,XX @@ static bool trans_LDNF1_zpri(DisasContext *s, arg_rpri_load *a)
         TCGv_i64 addr = new_tmp_a64(s);
 
         tcg_gen_addi_i64(addr, cpu_reg_sp(s, a->rn), off);
-        do_mem_zpa(s, a->rd, a->pg, addr, a->dtype,
+        do_mem_zpa(s, a->rd, a->pg, addr, a->dtype, 0, false,
                    fns[s->be_data == MO_BE][a->dtype]);
     }
     return true;
@@ -XXX,XX +XXX,XX @@ static void do_st_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
         fn = fn_multiple[be][nreg - 1][msz];
     }
     assert(fn != NULL);
-    do_mem_zpa(s, zt, pg, addr, msz_dtype(s, msz), fn);
+    do_mem_zpa(s, zt, pg, addr, msz_dtype(s, msz), 0, true, fn);
 }
 
 static bool trans_ST_zprr(DisasContext *s, arg_rprr_store *a)
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Because the elements are sequential, we can eliminate many tests all
at once when the tag hits TCMA, or if the page(s) are not Tagged.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-35-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    |  47 +++++++++++
 target/arm/sve_helper.c    |  95 ++++++++++++++++------
 target/arm/translate-sve.c | 162 ++++++++++++++++++++++++-------------
 3 files changed, 226 insertions(+), 78 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Because the elements are sequential, we can eliminate many tests all
at once when the tag hits TCMA, or if the page(s) are not Tagged.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-36-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    |  98 ++++++++++++++++
 target/arm/sve_helper.c    |  99 ++++++++++++++--
 target/arm/translate-sve.c | 232 +++++++++++++++++++++++++------------
 3 files changed, 343 insertions(+), 86 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

We still need to handle tbi for user-only when mte is inactive.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-37-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.h | 1 +
 target/arm/translate-a64.c | 2 +-
 target/arm/translate-sve.c | 6 ++++--
 3 files changed, 6 insertions(+), 3 deletions(-)

diff --git a/target/arm/translate-a64.h b/target/arm/translate-a64.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.h
+++ b/target/arm/translate-a64.h
@@ -XXX,XX +XXX,XX @@ TCGv_ptr get_fpstatus_ptr(bool);
 bool logic_imm_decode_wmask(uint64_t *result, unsigned int immn,
                             unsigned int imms, unsigned int immr);
 bool sve_access_check(DisasContext *s);
+TCGv_i64 clean_data_tbi(DisasContext *s, TCGv_i64 addr);
 TCGv_i64 gen_mte_check1(DisasContext *s, TCGv_i64 addr, bool is_write,
                         bool tag_checked, int log2_size);
 TCGv_i64 gen_mte_checkN(DisasContext *s, TCGv_i64 addr, bool is_write,
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void gen_a64_set_pc(DisasContext *s, TCGv_i64 src)
  * of the write-back address.
  */
 
-static TCGv_i64 clean_data_tbi(DisasContext *s, TCGv_i64 addr)
+TCGv_i64 clean_data_tbi(DisasContext *s, TCGv_i64 addr)
 {
     TCGv_i64 clean = new_tmp_a64(s);
 #ifdef CONFIG_USER_ONLY
diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
      * For e.g. LD4, there are not enough arguments to pass all 4
      * registers as pointers, so encode the regno into the data field.
      * For consistency, do this even for LD1.
-     * TODO: mte_n check here while callers are updated.
      */
-    if (mte_n && s->mte_active[0]) {
+    if (s->mte_active[0]) {
         int msz = dtype_msz(dtype);
 
         desc = FIELD_DP32(desc, MTEDESC, MIDX, get_mem_index(s));
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
         desc = FIELD_DP32(desc, MTEDESC, ESIZE, 1 << msz);
         desc = FIELD_DP32(desc, MTEDESC, TSIZE, mte_n << msz);
         desc <<= SVE_MTEDESC_SHIFT;
+    } else {
+        addr = clean_data_tbi(s, addr);
     }
+
     desc = simd_desc(vsz, vsz, zt | desc);
     t_desc = tcg_const_i32(desc);
     t_pg = tcg_temp_new_ptr();
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Because the elements are non-sequential, we cannot eliminate many
tests straight away like we can for sequential operations.  But
we often have the PTE details handy, so we can test for Tagged.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-38-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    | 285 ++++++++++++++++
 target/arm/sve_helper.c    | 185 +++++++++--
 target/arm/translate-sve.c | 650 +++++++++++++++++++++++++------------
 3 files changed, 872 insertions(+), 248 deletions(-)

diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper-sve.h
+++ b/target/arm/helper-sve.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_6(sve_ldsds_le_zd, TCG_CALL_NO_WG,
 DEF_HELPER_FLAGS_6(sve_ldsds_be_zd, TCG_CALL_NO_WG,
                    void, env, ptr, ptr, ptr, tl, i32)
 
+DEF_HELPER_FLAGS_6(sve_ldbsu_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhsu_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhsu_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldss_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldss_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldbss_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhss_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhss_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_6(sve_ldbsu_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhsu_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhsu_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldss_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldss_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldbss_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhss_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhss_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_6(sve_ldbdu_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhdu_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhdu_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsdu_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsdu_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_lddd_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_lddd_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldbds_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhds_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhds_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsds_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsds_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_6(sve_ldbdu_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhdu_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhdu_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsdu_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsdu_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_lddd_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_lddd_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldbds_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhds_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhds_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsds_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsds_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_6(sve_ldbdu_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhdu_le_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhdu_be_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsdu_le_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsdu_be_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_lddd_le_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_lddd_be_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldbds_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhds_le_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhds_be_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsds_le_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsds_be_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
 DEF_HELPER_FLAGS_6(sve_ldffbsu_zsu, TCG_CALL_NO_WG,
                    void, env, ptr, ptr, ptr, tl, i32)
 DEF_HELPER_FLAGS_6(sve_ldffhsu_le_zsu, TCG_CALL_NO_WG,
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_6(sve_ldffsds_le_zd, TCG_CALL_NO_WG,
 DEF_HELPER_FLAGS_6(sve_ldffsds_be_zd, TCG_CALL_NO_WG,
                    void, env, ptr, ptr, ptr, tl, i32)
 
+DEF_HELPER_FLAGS_6(sve_ldffbsu_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhsu_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhsu_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffss_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffss_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffbss_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhss_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhss_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_6(sve_ldffbsu_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhsu_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhsu_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffss_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffss_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffbss_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhss_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhss_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_6(sve_ldffbdu_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhdu_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhdu_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffsdu_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffsdu_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffdd_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffdd_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffbds_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhds_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhds_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffsds_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffsds_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_6(sve_ldffbdu_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhdu_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhdu_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffsdu_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffsdu_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffdd_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffdd_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffbds_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhds_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhds_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffsds_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffsds_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_6(sve_ldffbdu_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhdu_le_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhdu_be_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffsdu_le_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffsdu_be_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffdd_le_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffdd_be_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffbds_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhds_le_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffhds_be_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffsds_le_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldffsds_be_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
 DEF_HELPER_FLAGS_6(sve_stbs_zsu, TCG_CALL_NO_WG,
                    void, env, ptr, ptr, ptr, tl, i32)
 DEF_HELPER_FLAGS_6(sve_sths_le_zsu, TCG_CALL_NO_WG,
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_6(sve_stdd_le_zd, TCG_CALL_NO_WG,
 DEF_HELPER_FLAGS_6(sve_stdd_be_zd, TCG_CALL_NO_WG,
                    void, env, ptr, ptr, ptr, tl, i32)
 
+DEF_HELPER_FLAGS_6(sve_stbs_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_sths_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_sths_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_stss_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_stss_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_6(sve_stbs_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_sths_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_sths_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_stss_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_stss_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_6(sve_stbd_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_sthd_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_sthd_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_stsd_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_stsd_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_stdd_le_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_stdd_be_zsu_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_6(sve_stbd_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_sthd_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_sthd_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_stsd_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_stsd_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_stdd_le_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_stdd_be_zss_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_6(sve_stbd_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_sthd_le_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_sthd_be_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_stsd_le_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_stsd_be_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_stdd_le_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_stdd_be_zd_mte, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
 DEF_HELPER_FLAGS_4(sve2_pmull_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve_helper.c
+++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ static target_ulong off_zd_d(void *reg, intptr_t reg_ofs)
 static inline QEMU_ALWAYS_INLINE
 void sve_ld1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
                target_ulong base, uint32_t desc, uintptr_t retaddr,
-               int esize, int msize, zreg_off_fn *off_fn,
+               uint32_t mtedesc, int esize, int msize,
+               zreg_off_fn *off_fn,
                sve_ldst1_host_fn *host_fn,
                sve_ldst1_tlb_fn *tlb_fn)
 {
@@ -XXX,XX +XXX,XX @@ void sve_ld1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
                         cpu_check_watchpoint(env_cpu(env), addr, msize,
                                              info.attrs, BP_MEM_READ, retaddr);
                     }
-                    /* TODO: MTE check */
+                    if (mtedesc && arm_tlb_mte_tagged(&info.attrs)) {
+                        mte_check1(env, mtedesc, addr, retaddr);
+                    }
                     host_fn(&scratch, reg_off, info.host);
                 } else {
                     /* Element crosses the page boundary. */
@@ -XXX,XX +XXX,XX @@ void sve_ld1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
                                              msize, info.attrs,
                                              BP_MEM_READ, retaddr);
                     }
-                    /* TODO: MTE check */
+                    if (mtedesc && arm_tlb_mte_tagged(&info.attrs)) {
+                        mte_check1(env, mtedesc, addr, retaddr);
+                    }
                     tlb_fn(env, &scratch, reg_off, addr, retaddr);
                 }
             }
@@ -XXX,XX +XXX,XX @@ void sve_ld1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
     memcpy(vd, &scratch, reg_max);
 }
 
+static inline QEMU_ALWAYS_INLINE
+void sve_ld1_z_mte(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
+                   target_ulong base, uint32_t desc, uintptr_t retaddr,
+                   int esize, int msize, zreg_off_fn *off_fn,
+                   sve_ldst1_host_fn *host_fn,
+                   sve_ldst1_tlb_fn *tlb_fn)
+{
+    uint32_t mtedesc = desc >> (SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
+    /* Remove mtedesc from the normal sve descriptor. */
+    desc = extract32(desc, 0, SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
+
+    /*
+     * ??? TODO: For the 32-bit offset extractions, base + ofs cannot
+     * offset base entirely over the address space hole to change the
+     * pointer tag, or change the bit55 selector.  So we could here
+     * examine TBI + TCMA like we do for sve_ldN_r_mte().
+     */
+    sve_ld1_z(env, vd, vg, vm, base, desc, retaddr, mtedesc,
+              esize, msize, off_fn, host_fn, tlb_fn);
+}
+
 #define DO_LD1_ZPZ_S(MEM, OFS, MSZ) \
 void HELPER(sve_ld##MEM##_##OFS)(CPUARMState *env, void *vd, void *vg,       \
                                  void *vm, target_ulong base, uint32_t desc) \
 {                                                                            \
-    sve_ld1_z(env, vd, vg, vm, base, desc, GETPC(), 4, 1 << MSZ,             \
+    sve_ld1_z(env, vd, vg, vm, base, desc, GETPC(), 0, 4, 1 << MSZ,          \
               off_##OFS##_s, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb);       \
+}                                                                            \
+void HELPER(sve_ld##MEM##_##OFS##_mte)(CPUARMState *env, void *vd, void *vg, \
+     void *vm, target_ulong base, uint32_t desc)                             \
+{                                                                            \
+    sve_ld1_z_mte(env, vd, vg, vm, base, desc, GETPC(), 4, 1 << MSZ,         \
+                  off_##OFS##_s, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb);   \
 }
 
 #define DO_LD1_ZPZ_D(MEM, OFS, MSZ) \
 void HELPER(sve_ld##MEM##_##OFS)(CPUARMState *env, void *vd, void *vg,       \
                                  void *vm, target_ulong base, uint32_t desc) \
 {                                                                            \
-    sve_ld1_z(env, vd, vg, vm, base, desc, GETPC(), 8, 1 << MSZ,             \
+    sve_ld1_z(env, vd, vg, vm, base, desc, GETPC(), 0, 8, 1 << MSZ,          \
               off_##OFS##_d, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb);       \
+}                                                                            \
+void HELPER(sve_ld##MEM##_##OFS##_mte)(CPUARMState *env, void *vd, void *vg, \
+    void *vm, target_ulong base, uint32_t desc)                              \
+{                                                                            \
+    sve_ld1_z_mte(env, vd, vg, vm, base, desc, GETPC(), 8, 1 << MSZ,         \
+                  off_##OFS##_d, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb);   \
 }
 
 DO_LD1_ZPZ_S(bsu, zsu, MO_8)
@@ -XXX,XX +XXX,XX @@ DO_LD1_ZPZ_D(dd_be, zd, MO_64)
 static inline QEMU_ALWAYS_INLINE
 void sve_ldff1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
                  target_ulong base, uint32_t desc, uintptr_t retaddr,
-                 const int esz, const int msz, zreg_off_fn *off_fn,
+                 uint32_t mtedesc, const int esz, const int msz,
+                 zreg_off_fn *off_fn,
                  sve_ldst1_host_fn *host_fn,
                  sve_ldst1_tlb_fn *tlb_fn)
 {
@@ -XXX,XX +XXX,XX @@ void sve_ldff1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
      * Probe the first element, allowing faults.
      */
     addr = base + (off_fn(vm, reg_off) << scale);
+    if (mtedesc) {
+        mte_check1(env, mtedesc, addr, retaddr);
+    }
     tlb_fn(env, vd, reg_off, addr, retaddr);
 
     /* After any fault, zero the other elements. */
@@ -XXX,XX +XXX,XX @@ void sve_ldff1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
                      (env_cpu(env), addr, msize) & BP_MEM_READ)) {
                     goto fault;
                 }
-                /* TODO: MTE check. */
+                if (mtedesc &&
+                    arm_tlb_mte_tagged(&info.attrs) &&
+                    !mte_probe1(env, mtedesc, addr)) {
+                    goto fault;
+                }
 
                 host_fn(vd, reg_off, info.host);
             }
@@ -XXX,XX +XXX,XX @@ void sve_ldff1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
     record_fault(env, reg_off, reg_max);
 }
 
-#define DO_LDFF1_ZPZ_S(MEM, OFS, MSZ) \
-void HELPER(sve_ldff##MEM##_##OFS)(CPUARMState *env, void *vd, void *vg,       \
-                                   void *vm, target_ulong base, uint32_t desc) \
-{                                                                              \
-    sve_ldff1_z(env, vd, vg, vm, base, desc, GETPC(), MO_32, MSZ,              \
-                off_##OFS##_s, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb);       \
+static inline QEMU_ALWAYS_INLINE
+void sve_ldff1_z_mte(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
+                     target_ulong base, uint32_t desc, uintptr_t retaddr,
+                     const int esz, const int msz,
+                     zreg_off_fn *off_fn,
+                     sve_ldst1_host_fn *host_fn,
+                     sve_ldst1_tlb_fn *tlb_fn)
+{
+    uint32_t mtedesc = desc >> (SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
+    /* Remove mtedesc from the normal sve descriptor. */
+    desc = extract32(desc, 0, SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
+
+    /*
+     * ??? TODO: For the 32-bit offset extractions, base + ofs cannot
+     * offset base entirely over the address space hole to change the
+     * pointer tag, or change the bit55 selector.  So we could here
+     * examine TBI + TCMA like we do for sve_ldN_r_mte().
+     */
+    sve_ldff1_z(env, vd, vg, vm, base, desc, retaddr, mtedesc,
+                esz, msz, off_fn, host_fn, tlb_fn);
 }
 
-#define DO_LDFF1_ZPZ_D(MEM, OFS, MSZ) \
-void HELPER(sve_ldff##MEM##_##OFS)(CPUARMState *env, void *vd, void *vg,       \
-                                   void *vm, target_ulong base, uint32_t desc) \
-{                                                                              \
-    sve_ldff1_z(env, vd, vg, vm, base, desc, GETPC(), MO_64, MSZ,              \
-                off_##OFS##_d, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb);       \
+#define DO_LDFF1_ZPZ_S(MEM, OFS, MSZ)                                   \
+void HELPER(sve_ldff##MEM##_##OFS)                                      \
+    (CPUARMState *env, void *vd, void *vg,                              \
+     void *vm, target_ulong base, uint32_t desc)                        \
+{                                                                       \
+    sve_ldff1_z(env, vd, vg, vm, base, desc, GETPC(), 0, MO_32, MSZ,    \
+                off_##OFS##_s, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb); \
+}                                                                       \
+void HELPER(sve_ldff##MEM##_##OFS##_mte)                                \
+    (CPUARMState *env, void *vd, void *vg,                              \
+     void *vm, target_ulong base, uint32_t desc)                        \
+{                                                                       \
+    sve_ldff1_z_mte(env, vd, vg, vm, base, desc, GETPC(), MO_32, MSZ,   \
+                    off_##OFS##_s, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb); \
+}
+
+#define DO_LDFF1_ZPZ_D(MEM, OFS, MSZ)                                   \
+void HELPER(sve_ldff##MEM##_##OFS)                                      \
+    (CPUARMState *env, void *vd, void *vg,                              \
+     void *vm, target_ulong base, uint32_t desc)                        \
+{                                                                       \
+    sve_ldff1_z(env, vd, vg, vm, base, desc, GETPC(), 0, MO_64, MSZ,    \
+                off_##OFS##_d, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb); \
+}                                                                       \
+void HELPER(sve_ldff##MEM##_##OFS##_mte)                                \
+    (CPUARMState *env, void *vd, void *vg,                              \
+     void *vm, target_ulong base, uint32_t desc)                        \
+{                                                                       \
+    sve_ldff1_z_mte(env, vd, vg, vm, base, desc, GETPC(), MO_64, MSZ,   \
+                    off_##OFS##_d, sve_ld1##MEM##_host, sve_ld1##MEM##_tlb); \
 }
 
 DO_LDFF1_ZPZ_S(bsu, zsu, MO_8)
@@ -XXX,XX +XXX,XX @@ DO_LDFF1_ZPZ_D(dd_be, zd, MO_64)
 static inline QEMU_ALWAYS_INLINE
 void sve_st1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
                target_ulong base, uint32_t desc, uintptr_t retaddr,
-               int esize, int msize, zreg_off_fn *off_fn,
+               uint32_t mtedesc, int esize, int msize,
+               zreg_off_fn *off_fn,
                sve_ldst1_host_fn *host_fn,
                sve_ldst1_tlb_fn *tlb_fn)
 {
@@ -XXX,XX +XXX,XX @@ void sve_st1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
                     cpu_check_watchpoint(env_cpu(env), addr, msize,
                                          info.attrs, BP_MEM_WRITE, retaddr);
                 }
-                /* TODO: MTE check. */
+
+                if (mtedesc && arm_tlb_mte_tagged(&info.attrs)) {
+                    mte_check1(env, mtedesc, addr, retaddr);
+                }
             }
             i += 1;
             reg_off += esize;
@@ -XXX,XX +XXX,XX @@ void sve_st1_z(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
     } while (reg_off < reg_max);
 }
 
-#define DO_ST1_ZPZ_S(MEM, OFS, MSZ) \
-void HELPER(sve_st##MEM##_##OFS)(CPUARMState *env, void *vd, void *vg,       \
-                                 void *vm, target_ulong base, uint32_t desc) \
-{                                                                            \
-    sve_st1_z(env, vd, vg, vm, base, desc, GETPC(), 4, 1 << MSZ,             \
-              off_##OFS##_s, sve_st1##MEM##_host, sve_st1##MEM##_tlb);       \
+static inline QEMU_ALWAYS_INLINE
+void sve_st1_z_mte(CPUARMState *env, void *vd, uint64_t *vg, void *vm,
+                   target_ulong base, uint32_t desc, uintptr_t retaddr,
+                   int esize, int msize, zreg_off_fn *off_fn,
+                   sve_ldst1_host_fn *host_fn,
+                   sve_ldst1_tlb_fn *tlb_fn)
+{
+    uint32_t mtedesc = desc >> (SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
+    /* Remove mtedesc from the normal sve descriptor. */
+    desc = extract32(desc, 0, SIMD_DATA_SHIFT + SVE_MTEDESC_SHIFT);
+
+    /*
+     * ??? TODO: For the 32-bit offset extractions, base + ofs cannot
+     * offset base entirely over the address space hole to change the
+     * pointer tag, or change the bit55 selector.  So we could here
+     * examine TBI + TCMA like we do for sve_ldN_r_mte().
+     */
+    sve_st1_z(env, vd, vg, vm, base, desc, retaddr, mtedesc,
+              esize, msize, off_fn, host_fn, tlb_fn);
 }
 
-#define DO_ST1_ZPZ_D(MEM, OFS, MSZ) \
-void HELPER(sve_st##MEM##_##OFS)(CPUARMState *env, void *vd, void *vg,       \
+#define DO_ST1_ZPZ_S(MEM, OFS, MSZ)                                     \
+void HELPER(sve_st##MEM##_##OFS)(CPUARMState *env, void *vd, void *vg,  \
                                  void *vm, target_ulong base, uint32_t desc) \
-{                                                                            \
-    sve_st1_z(env, vd, vg, vm, base, desc, GETPC(), 8, 1 << MSZ,             \
-              off_##OFS##_d, sve_st1##MEM##_host, sve_st1##MEM##_tlb);       \
+{                                                                       \
+    sve_st1_z(env, vd, vg, vm, base, desc, GETPC(), 0, 4, 1 << MSZ,     \
+              off_##OFS##_s, sve_st1##MEM##_host, sve_st1##MEM##_tlb);  \
+}                                                                       \
+void HELPER(sve_st##MEM##_##OFS##_mte)(CPUARMState *env, void *vd, void *vg, \
+    void *vm, target_ulong base, uint32_t desc)                         \
+{                                                                       \
+    sve_st1_z_mte(env, vd, vg, vm, base, desc, GETPC(), 4, 1 << MSZ,    \
+                  off_##OFS##_s, sve_st1##MEM##_host, sve_st1##MEM##_tlb); \
+}
+
+#define DO_ST1_ZPZ_D(MEM, OFS, MSZ)                                     \
+void HELPER(sve_st##MEM##_##OFS)(CPUARMState *env, void *vd, void *vg,  \
+                                 void *vm, target_ulong base, uint32_t desc) \
+{                                                                       \
+    sve_st1_z(env, vd, vg, vm, base, desc, GETPC(), 0, 8, 1 << MSZ,     \
+              off_##OFS##_d, sve_st1##MEM##_host, sve_st1##MEM##_tlb);  \
+}                                                                       \
+void HELPER(sve_st##MEM##_##OFS##_mte)(CPUARMState *env, void *vd, void *vg, \
+    void *vm, target_ulong base, uint32_t desc)                         \
+{                                                                       \
+    sve_st1_z_mte(env, vd, vg, vm, base, desc, GETPC(), 8, 1 << MSZ,    \
+                  off_##OFS##_d, sve_st1##MEM##_host, sve_st1##MEM##_tlb); \
 }
 
 DO_ST1_ZPZ_S(bs, zsu, MO_8)
diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_ST_zpri(DisasContext *s, arg_rpri_store *a)
  */
 
 static void do_mem_zpz(DisasContext *s, int zt, int pg, int zm,
-                       int scale, TCGv_i64 scalar, int msz,
+                       int scale, TCGv_i64 scalar, int msz, bool is_write,
                        gen_helper_gvec_mem_scatter *fn)
 {
     unsigned vsz = vec_full_reg_size(s);
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpz(DisasContext *s, int zt, int pg, int zm,
     TCGv_ptr t_pg = tcg_temp_new_ptr();
     TCGv_ptr t_zt = tcg_temp_new_ptr();
     TCGv_i32 t_desc;
-    int desc;
+    int desc = 0;
 
+    if (s->mte_active[0]) {
+        desc = FIELD_DP32(desc, MTEDESC, MIDX, get_mem_index(s));
+        desc = FIELD_DP32(desc, MTEDESC, TBI, s->tbid);
+        desc = FIELD_DP32(desc, MTEDESC, TCMA, s->tcma);
+        desc = FIELD_DP32(desc, MTEDESC, WRITE, is_write);
+        desc = FIELD_DP32(desc, MTEDESC, ESIZE, 1 << msz);
+        desc <<= SVE_MTEDESC_SHIFT;
+    }
     desc = simd_desc(vsz, vsz, scale);
     t_desc = tcg_const_i32(desc);
 
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpz(DisasContext *s, int zt, int pg, int zm,
     tcg_temp_free_i32(t_desc);
 }
 
-/* Indexed by [be][ff][xs][u][msz].  */
-static gen_helper_gvec_mem_scatter * const gather_load_fn32[2][2][2][2][3] = {
-    /* Little-endian */
-    { { { { gen_helper_sve_ldbss_zsu,
-            gen_helper_sve_ldhss_le_zsu,
-            NULL, },
-          { gen_helper_sve_ldbsu_zsu,
-            gen_helper_sve_ldhsu_le_zsu,
-            gen_helper_sve_ldss_le_zsu, } },
-        { { gen_helper_sve_ldbss_zss,
-            gen_helper_sve_ldhss_le_zss,
-            NULL, },
-          { gen_helper_sve_ldbsu_zss,
-            gen_helper_sve_ldhsu_le_zss,
-            gen_helper_sve_ldss_le_zss, } } },
+/* Indexed by [mte][be][ff][xs][u][msz].  */
+static gen_helper_gvec_mem_scatter * const
+gather_load_fn32[2][2][2][2][2][3] = {
+    { /* MTE Inactive */
+        { /* Little-endian */
+            { { { gen_helper_sve_ldbss_zsu,
+                  gen_helper_sve_ldhss_le_zsu,
+                  NULL, },
+                { gen_helper_sve_ldbsu_zsu,
+                  gen_helper_sve_ldhsu_le_zsu,
+                  gen_helper_sve_ldss_le_zsu, } },
+              { { gen_helper_sve_ldbss_zss,
+                  gen_helper_sve_ldhss_le_zss,
+                  NULL, },
+                { gen_helper_sve_ldbsu_zss,
+                  gen_helper_sve_ldhsu_le_zss,
+                  gen_helper_sve_ldss_le_zss, } } },
 
-      /* First-fault */
-      { { { gen_helper_sve_ldffbss_zsu,
-            gen_helper_sve_ldffhss_le_zsu,
-            NULL, },
-          { gen_helper_sve_ldffbsu_zsu,
-            gen_helper_sve_ldffhsu_le_zsu,
-            gen_helper_sve_ldffss_le_zsu, } },
-        { { gen_helper_sve_ldffbss_zss,
-            gen_helper_sve_ldffhss_le_zss,
-            NULL, },
-          { gen_helper_sve_ldffbsu_zss,
-            gen_helper_sve_ldffhsu_le_zss,
-            gen_helper_sve_ldffss_le_zss, } } } },
+            /* First-fault */
+            { { { gen_helper_sve_ldffbss_zsu,
+                  gen_helper_sve_ldffhss_le_zsu,
+                  NULL, },
+                { gen_helper_sve_ldffbsu_zsu,
+                  gen_helper_sve_ldffhsu_le_zsu,
+                  gen_helper_sve_ldffss_le_zsu, } },
+              { { gen_helper_sve_ldffbss_zss,
+                  gen_helper_sve_ldffhss_le_zss,
+                  NULL, },
+                { gen_helper_sve_ldffbsu_zss,
+                  gen_helper_sve_ldffhsu_le_zss,
+                  gen_helper_sve_ldffss_le_zss, } } } },
 
-    /* Big-endian */
-    { { { { gen_helper_sve_ldbss_zsu,
-            gen_helper_sve_ldhss_be_zsu,
-            NULL, },
-          { gen_helper_sve_ldbsu_zsu,
-            gen_helper_sve_ldhsu_be_zsu,
-            gen_helper_sve_ldss_be_zsu, } },
-        { { gen_helper_sve_ldbss_zss,
-            gen_helper_sve_ldhss_be_zss,
-            NULL, },
-          { gen_helper_sve_ldbsu_zss,
-            gen_helper_sve_ldhsu_be_zss,
-            gen_helper_sve_ldss_be_zss, } } },
+        { /* Big-endian */
+            { { { gen_helper_sve_ldbss_zsu,
+                  gen_helper_sve_ldhss_be_zsu,
+                  NULL, },
+                { gen_helper_sve_ldbsu_zsu,
+                  gen_helper_sve_ldhsu_be_zsu,
+                  gen_helper_sve_ldss_be_zsu, } },
+              { { gen_helper_sve_ldbss_zss,
+                  gen_helper_sve_ldhss_be_zss,
+                  NULL, },
+                { gen_helper_sve_ldbsu_zss,
+                  gen_helper_sve_ldhsu_be_zss,
+                  gen_helper_sve_ldss_be_zss, } } },
 
-      /* First-fault */
-      { { { gen_helper_sve_ldffbss_zsu,
-            gen_helper_sve_ldffhss_be_zsu,
-            NULL, },
-          { gen_helper_sve_ldffbsu_zsu,
-            gen_helper_sve_ldffhsu_be_zsu,
-            gen_helper_sve_ldffss_be_zsu, } },
-        { { gen_helper_sve_ldffbss_zss,
-            gen_helper_sve_ldffhss_be_zss,
-            NULL, },
-          { gen_helper_sve_ldffbsu_zss,
-            gen_helper_sve_ldffhsu_be_zss,
-            gen_helper_sve_ldffss_be_zss, } } } },
+            /* First-fault */
+            { { { gen_helper_sve_ldffbss_zsu,
+                  gen_helper_sve_ldffhss_be_zsu,
+                  NULL, },
+                { gen_helper_sve_ldffbsu_zsu,
+                  gen_helper_sve_ldffhsu_be_zsu,
+                  gen_helper_sve_ldffss_be_zsu, } },
+              { { gen_helper_sve_ldffbss_zss,
+                  gen_helper_sve_ldffhss_be_zss,
+                  NULL, },
+                { gen_helper_sve_ldffbsu_zss,
+                  gen_helper_sve_ldffhsu_be_zss,
+                  gen_helper_sve_ldffss_be_zss, } } } } },
+    { /* MTE Active */
+        { /* Little-endian */
+            { { { gen_helper_sve_ldbss_zsu_mte,
+                  gen_helper_sve_ldhss_le_zsu_mte,
+                  NULL, },
+                { gen_helper_sve_ldbsu_zsu_mte,
+                  gen_helper_sve_ldhsu_le_zsu_mte,
+                  gen_helper_sve_ldss_le_zsu_mte, } },
+              { { gen_helper_sve_ldbss_zss_mte,
+                  gen_helper_sve_ldhss_le_zss_mte,
+                  NULL, },
+                { gen_helper_sve_ldbsu_zss_mte,
+                  gen_helper_sve_ldhsu_le_zss_mte,
+                  gen_helper_sve_ldss_le_zss_mte, } } },
+
+            /* First-fault */
+            { { { gen_helper_sve_ldffbss_zsu_mte,
+                  gen_helper_sve_ldffhss_le_zsu_mte,
+                  NULL, },
+                { gen_helper_sve_ldffbsu_zsu_mte,
+                  gen_helper_sve_ldffhsu_le_zsu_mte,
+                  gen_helper_sve_ldffss_le_zsu_mte, } },
+              { { gen_helper_sve_ldffbss_zss_mte,
+                  gen_helper_sve_ldffhss_le_zss_mte,
+                  NULL, },
+                { gen_helper_sve_ldffbsu_zss_mte,
+                  gen_helper_sve_ldffhsu_le_zss_mte,
+                  gen_helper_sve_ldffss_le_zss_mte, } } } },
+
+        { /* Big-endian */
+            { { { gen_helper_sve_ldbss_zsu_mte,
+                  gen_helper_sve_ldhss_be_zsu_mte,
+                  NULL, },
+                { gen_helper_sve_ldbsu_zsu_mte,
+                  gen_helper_sve_ldhsu_be_zsu_mte,
+                  gen_helper_sve_ldss_be_zsu_mte, } },
+              { { gen_helper_sve_ldbss_zss_mte,
+                  gen_helper_sve_ldhss_be_zss_mte,
+                  NULL, },
+                { gen_helper_sve_ldbsu_zss_mte,
+                  gen_helper_sve_ldhsu_be_zss_mte,
+                  gen_helper_sve_ldss_be_zss_mte, } } },
+
+            /* First-fault */
+            { { { gen_helper_sve_ldffbss_zsu_mte,
+                  gen_helper_sve_ldffhss_be_zsu_mte,
+                  NULL, },
+                { gen_helper_sve_ldffbsu_zsu_mte,
+                  gen_helper_sve_ldffhsu_be_zsu_mte,
+                  gen_helper_sve_ldffss_be_zsu_mte, } },
+              { { gen_helper_sve_ldffbss_zss_mte,
+                  gen_helper_sve_ldffhss_be_zss_mte,
+                  NULL, },
+                { gen_helper_sve_ldffbsu_zss_mte,
+                  gen_helper_sve_ldffhsu_be_zss_mte,
+                  gen_helper_sve_ldffss_be_zss_mte, } } } } },
 };
 
 /* Note that we overload xs=2 to indicate 64-bit offset.  */
-static gen_helper_gvec_mem_scatter * const gather_load_fn64[2][2][3][2][4] = {
-    /* Little-endian */
-    { { { { gen_helper_sve_ldbds_zsu,
-            gen_helper_sve_ldhds_le_zsu,
-            gen_helper_sve_ldsds_le_zsu,
-            NULL, },
-          { gen_helper_sve_ldbdu_zsu,
-            gen_helper_sve_ldhdu_le_zsu,
-            gen_helper_sve_ldsdu_le_zsu,
-            gen_helper_sve_lddd_le_zsu, } },
-        { { gen_helper_sve_ldbds_zss,
-            gen_helper_sve_ldhds_le_zss,
-            gen_helper_sve_ldsds_le_zss,
-            NULL, },
-          { gen_helper_sve_ldbdu_zss,
-            gen_helper_sve_ldhdu_le_zss,
-            gen_helper_sve_ldsdu_le_zss,
-            gen_helper_sve_lddd_le_zss, } },
-        { { gen_helper_sve_ldbds_zd,
-            gen_helper_sve_ldhds_le_zd,
-            gen_helper_sve_ldsds_le_zd,
-            NULL, },
-          { gen_helper_sve_ldbdu_zd,
-            gen_helper_sve_ldhdu_le_zd,
-            gen_helper_sve_ldsdu_le_zd,
-            gen_helper_sve_lddd_le_zd, } } },
+static gen_helper_gvec_mem_scatter * const
+gather_load_fn64[2][2][2][3][2][4] = {
+    { /* MTE Inactive */
+        { /* Little-endian */
+            { { { gen_helper_sve_ldbds_zsu,
+                  gen_helper_sve_ldhds_le_zsu,
+                  gen_helper_sve_ldsds_le_zsu,
+                  NULL, },
+                { gen_helper_sve_ldbdu_zsu,
+                  gen_helper_sve_ldhdu_le_zsu,
+                  gen_helper_sve_ldsdu_le_zsu,
+                  gen_helper_sve_lddd_le_zsu, } },
+              { { gen_helper_sve_ldbds_zss,
+                  gen_helper_sve_ldhds_le_zss,
+                  gen_helper_sve_ldsds_le_zss,
+                  NULL, },
+                { gen_helper_sve_ldbdu_zss,
+                  gen_helper_sve_ldhdu_le_zss,
+                  gen_helper_sve_ldsdu_le_zss,
+                  gen_helper_sve_lddd_le_zss, } },
+              { { gen_helper_sve_ldbds_zd,
+                  gen_helper_sve_ldhds_le_zd,
+                  gen_helper_sve_ldsds_le_zd,
+                  NULL, },
+                { gen_helper_sve_ldbdu_zd,
+                  gen_helper_sve_ldhdu_le_zd,
+                  gen_helper_sve_ldsdu_le_zd,
+                  gen_helper_sve_lddd_le_zd, } } },
 
-      /* First-fault */
-      { { { gen_helper_sve_ldffbds_zsu,
-            gen_helper_sve_ldffhds_le_zsu,
-            gen_helper_sve_ldffsds_le_zsu,
-            NULL, },
-          { gen_helper_sve_ldffbdu_zsu,
-            gen_helper_sve_ldffhdu_le_zsu,
-            gen_helper_sve_ldffsdu_le_zsu,
-            gen_helper_sve_ldffdd_le_zsu, } },
-        { { gen_helper_sve_ldffbds_zss,
-            gen_helper_sve_ldffhds_le_zss,
-            gen_helper_sve_ldffsds_le_zss,
-            NULL, },
-          { gen_helper_sve_ldffbdu_zss,
-            gen_helper_sve_ldffhdu_le_zss,
-            gen_helper_sve_ldffsdu_le_zss,
-            gen_helper_sve_ldffdd_le_zss, } },
-        { { gen_helper_sve_ldffbds_zd,
-            gen_helper_sve_ldffhds_le_zd,
-            gen_helper_sve_ldffsds_le_zd,
-            NULL, },
-          { gen_helper_sve_ldffbdu_zd,
-            gen_helper_sve_ldffhdu_le_zd,
-            gen_helper_sve_ldffsdu_le_zd,
-            gen_helper_sve_ldffdd_le_zd, } } } },
+            /* First-fault */
+            { { { gen_helper_sve_ldffbds_zsu,
+                  gen_helper_sve_ldffhds_le_zsu,
+                  gen_helper_sve_ldffsds_le_zsu,
+                  NULL, },
+                { gen_helper_sve_ldffbdu_zsu,
+                  gen_helper_sve_ldffhdu_le_zsu,
+                  gen_helper_sve_ldffsdu_le_zsu,
+                  gen_helper_sve_ldffdd_le_zsu, } },
+              { { gen_helper_sve_ldffbds_zss,
+                  gen_helper_sve_ldffhds_le_zss,
+                  gen_helper_sve_ldffsds_le_zss,
+                  NULL, },
+                { gen_helper_sve_ldffbdu_zss,
+                  gen_helper_sve_ldffhdu_le_zss,
+                  gen_helper_sve_ldffsdu_le_zss,
+                  gen_helper_sve_ldffdd_le_zss, } },
+              { { gen_helper_sve_ldffbds_zd,
+                  gen_helper_sve_ldffhds_le_zd,
+                  gen_helper_sve_ldffsds_le_zd,
+                  NULL, },
+                { gen_helper_sve_ldffbdu_zd,
+                  gen_helper_sve_ldffhdu_le_zd,
+                  gen_helper_sve_ldffsdu_le_zd,
+                  gen_helper_sve_ldffdd_le_zd, } } } },
+        { /* Big-endian */
+            { { { gen_helper_sve_ldbds_zsu,
+                  gen_helper_sve_ldhds_be_zsu,
+                  gen_helper_sve_ldsds_be_zsu,
+                  NULL, },
+                { gen_helper_sve_ldbdu_zsu,
+                  gen_helper_sve_ldhdu_be_zsu,
+                  gen_helper_sve_ldsdu_be_zsu,
+                  gen_helper_sve_lddd_be_zsu, } },
+              { { gen_helper_sve_ldbds_zss,
+                  gen_helper_sve_ldhds_be_zss,
+                  gen_helper_sve_ldsds_be_zss,
+                  NULL, },
+                { gen_helper_sve_ldbdu_zss,
+                  gen_helper_sve_ldhdu_be_zss,
+                  gen_helper_sve_ldsdu_be_zss,
+                  gen_helper_sve_lddd_be_zss, } },
+              { { gen_helper_sve_ldbds_zd,
+                  gen_helper_sve_ldhds_be_zd,
+                  gen_helper_sve_ldsds_be_zd,
+                  NULL, },
+                { gen_helper_sve_ldbdu_zd,
+                  gen_helper_sve_ldhdu_be_zd,
+                  gen_helper_sve_ldsdu_be_zd,
+                  gen_helper_sve_lddd_be_zd, } } },
 
-    /* Big-endian */
-    { { { { gen_helper_sve_ldbds_zsu,
-            gen_helper_sve_ldhds_be_zsu,
-            gen_helper_sve_ldsds_be_zsu,
-            NULL, },
-          { gen_helper_sve_ldbdu_zsu,
-            gen_helper_sve_ldhdu_be_zsu,
-            gen_helper_sve_ldsdu_be_zsu,
-            gen_helper_sve_lddd_be_zsu, } },
-        { { gen_helper_sve_ldbds_zss,
-            gen_helper_sve_ldhds_be_zss,
-            gen_helper_sve_ldsds_be_zss,
-            NULL, },
-          { gen_helper_sve_ldbdu_zss,
-            gen_helper_sve_ldhdu_be_zss,
-            gen_helper_sve_ldsdu_be_zss,
-            gen_helper_sve_lddd_be_zss, } },
-        { { gen_helper_sve_ldbds_zd,
-            gen_helper_sve_ldhds_be_zd,
-            gen_helper_sve_ldsds_be_zd,
-            NULL, },
-          { gen_helper_sve_ldbdu_zd,
-            gen_helper_sve_ldhdu_be_zd,
-            gen_helper_sve_ldsdu_be_zd,
-            gen_helper_sve_lddd_be_zd, } } },
+            /* First-fault */
+            { { { gen_helper_sve_ldffbds_zsu,
+                  gen_helper_sve_ldffhds_be_zsu,
+                  gen_helper_sve_ldffsds_be_zsu,
+                  NULL, },
+                { gen_helper_sve_ldffbdu_zsu,
+                  gen_helper_sve_ldffhdu_be_zsu,
+                  gen_helper_sve_ldffsdu_be_zsu,
+                  gen_helper_sve_ldffdd_be_zsu, } },
+              { { gen_helper_sve_ldffbds_zss,
+                  gen_helper_sve_ldffhds_be_zss,
+                  gen_helper_sve_ldffsds_be_zss,
+                  NULL, },
+                { gen_helper_sve_ldffbdu_zss,
+                  gen_helper_sve_ldffhdu_be_zss,
+                  gen_helper_sve_ldffsdu_be_zss,
+                  gen_helper_sve_ldffdd_be_zss, } },
+              { { gen_helper_sve_ldffbds_zd,
+                  gen_helper_sve_ldffhds_be_zd,
+                  gen_helper_sve_ldffsds_be_zd,
+                  NULL, },
+                { gen_helper_sve_ldffbdu_zd,
+                  gen_helper_sve_ldffhdu_be_zd,
+                  gen_helper_sve_ldffsdu_be_zd,
+                  gen_helper_sve_ldffdd_be_zd, } } } } },
+    { /* MTE Active */
+        { /* Little-endian */
+            { { { gen_helper_sve_ldbds_zsu_mte,
+                  gen_helper_sve_ldhds_le_zsu_mte,
+                  gen_helper_sve_ldsds_le_zsu_mte,
+                  NULL, },
+                { gen_helper_sve_ldbdu_zsu_mte,
+                  gen_helper_sve_ldhdu_le_zsu_mte,
+                  gen_helper_sve_ldsdu_le_zsu_mte,
+                  gen_helper_sve_lddd_le_zsu_mte, } },
+              { { gen_helper_sve_ldbds_zss_mte,
+                  gen_helper_sve_ldhds_le_zss_mte,
+                  gen_helper_sve_ldsds_le_zss_mte,
+                  NULL, },
+                { gen_helper_sve_ldbdu_zss_mte,
+                  gen_helper_sve_ldhdu_le_zss_mte,
+                  gen_helper_sve_ldsdu_le_zss_mte,
+                  gen_helper_sve_lddd_le_zss_mte, } },
+              { { gen_helper_sve_ldbds_zd_mte,
+                  gen_helper_sve_ldhds_le_zd_mte,
+                  gen_helper_sve_ldsds_le_zd_mte,
+                  NULL, },
+                { gen_helper_sve_ldbdu_zd_mte,
+                  gen_helper_sve_ldhdu_le_zd_mte,
+                  gen_helper_sve_ldsdu_le_zd_mte,
+                  gen_helper_sve_lddd_le_zd_mte, } } },
 
-      /* First-fault */
-      { { { gen_helper_sve_ldffbds_zsu,
-            gen_helper_sve_ldffhds_be_zsu,
-            gen_helper_sve_ldffsds_be_zsu,
-            NULL, },
-          { gen_helper_sve_ldffbdu_zsu,
-            gen_helper_sve_ldffhdu_be_zsu,
-            gen_helper_sve_ldffsdu_be_zsu,
-            gen_helper_sve_ldffdd_be_zsu, } },
-        { { gen_helper_sve_ldffbds_zss,
-            gen_helper_sve_ldffhds_be_zss,
-            gen_helper_sve_ldffsds_be_zss,
-            NULL, },
-          { gen_helper_sve_ldffbdu_zss,
-            gen_helper_sve_ldffhdu_be_zss,
-            gen_helper_sve_ldffsdu_be_zss,
-            gen_helper_sve_ldffdd_be_zss, } },
-        { { gen_helper_sve_ldffbds_zd,
-            gen_helper_sve_ldffhds_be_zd,
-            gen_helper_sve_ldffsds_be_zd,
-            NULL, },
-          { gen_helper_sve_ldffbdu_zd,
-            gen_helper_sve_ldffhdu_be_zd,
-            gen_helper_sve_ldffsdu_be_zd,
-            gen_helper_sve_ldffdd_be_zd, } } } },
+            /* First-fault */
+            { { { gen_helper_sve_ldffbds_zsu_mte,
+                  gen_helper_sve_ldffhds_le_zsu_mte,
+                  gen_helper_sve_ldffsds_le_zsu_mte,
+                  NULL, },
+                { gen_helper_sve_ldffbdu_zsu_mte,
+                  gen_helper_sve_ldffhdu_le_zsu_mte,
+                  gen_helper_sve_ldffsdu_le_zsu_mte,
+                  gen_helper_sve_ldffdd_le_zsu_mte, } },
+              { { gen_helper_sve_ldffbds_zss_mte,
+                  gen_helper_sve_ldffhds_le_zss_mte,
+                  gen_helper_sve_ldffsds_le_zss_mte,
+                  NULL, },
+                { gen_helper_sve_ldffbdu_zss_mte,
+                  gen_helper_sve_ldffhdu_le_zss_mte,
+                  gen_helper_sve_ldffsdu_le_zss_mte,
+                  gen_helper_sve_ldffdd_le_zss_mte, } },
+              { { gen_helper_sve_ldffbds_zd_mte,
+                  gen_helper_sve_ldffhds_le_zd_mte,
+                  gen_helper_sve_ldffsds_le_zd_mte,
+                  NULL, },
+                { gen_helper_sve_ldffbdu_zd_mte,
+                  gen_helper_sve_ldffhdu_le_zd_mte,
+                  gen_helper_sve_ldffsdu_le_zd_mte,
+                  gen_helper_sve_ldffdd_le_zd_mte, } } } },
+        { /* Big-endian */
+            { { { gen_helper_sve_ldbds_zsu_mte,
+                  gen_helper_sve_ldhds_be_zsu_mte,
+                  gen_helper_sve_ldsds_be_zsu_mte,
+                  NULL, },
+                { gen_helper_sve_ldbdu_zsu_mte,
+                  gen_helper_sve_ldhdu_be_zsu_mte,
+                  gen_helper_sve_ldsdu_be_zsu_mte,
+                  gen_helper_sve_lddd_be_zsu_mte, } },
+              { { gen_helper_sve_ldbds_zss_mte,
+                  gen_helper_sve_ldhds_be_zss_mte,
+                  gen_helper_sve_ldsds_be_zss_mte,
+                  NULL, },
+                { gen_helper_sve_ldbdu_zss_mte,
+                  gen_helper_sve_ldhdu_be_zss_mte,
+                  gen_helper_sve_ldsdu_be_zss_mte,
+                  gen_helper_sve_lddd_be_zss_mte, } },
+              { { gen_helper_sve_ldbds_zd_mte,
+                  gen_helper_sve_ldhds_be_zd_mte,
+                  gen_helper_sve_ldsds_be_zd_mte,
+                  NULL, },
+                { gen_helper_sve_ldbdu_zd_mte,
+                  gen_helper_sve_ldhdu_be_zd_mte,
+                  gen_helper_sve_ldsdu_be_zd_mte,
+                  gen_helper_sve_lddd_be_zd_mte, } } },
+
+            /* First-fault */
+            { { { gen_helper_sve_ldffbds_zsu_mte,
+                  gen_helper_sve_ldffhds_be_zsu_mte,
+                  gen_helper_sve_ldffsds_be_zsu_mte,
+                  NULL, },
+                { gen_helper_sve_ldffbdu_zsu_mte,
+                  gen_helper_sve_ldffhdu_be_zsu_mte,
+                  gen_helper_sve_ldffsdu_be_zsu_mte,
+                  gen_helper_sve_ldffdd_be_zsu_mte, } },
+              { { gen_helper_sve_ldffbds_zss_mte,
+                  gen_helper_sve_ldffhds_be_zss_mte,
+                  gen_helper_sve_ldffsds_be_zss_mte,
+                  NULL, },
+                { gen_helper_sve_ldffbdu_zss_mte,
+                  gen_helper_sve_ldffhdu_be_zss_mte,
+                  gen_helper_sve_ldffsdu_be_zss_mte,
+                  gen_helper_sve_ldffdd_be_zss_mte, } },
+              { { gen_helper_sve_ldffbds_zd_mte,
+                  gen_helper_sve_ldffhds_be_zd_mte,
+                  gen_helper_sve_ldffsds_be_zd_mte,
+                  NULL, },
+                { gen_helper_sve_ldffbdu_zd_mte,
+                  gen_helper_sve_ldffhdu_be_zd_mte,
+                  gen_helper_sve_ldffsdu_be_zd_mte,
+                  gen_helper_sve_ldffdd_be_zd_mte, } } } } },
 };
 
 static bool trans_LD1_zprz(DisasContext *s, arg_LD1_zprz *a)
 {
     gen_helper_gvec_mem_scatter *fn = NULL;
-    int be = s->be_data == MO_BE;
+    bool be = s->be_data == MO_BE;
+    bool mte = s->mte_active[0];
 
     if (!sve_access_check(s)) {
         return true;
@@ -XXX,XX +XXX,XX @@ static bool trans_LD1_zprz(DisasContext *s, arg_LD1_zprz *a)
 
     switch (a->esz) {
     case MO_32:
-        fn = gather_load_fn32[be][a->ff][a->xs][a->u][a->msz];
+        fn = gather_load_fn32[mte][be][a->ff][a->xs][a->u][a->msz];
         break;
     case MO_64:
-        fn = gather_load_fn64[be][a->ff][a->xs][a->u][a->msz];
+        fn = gather_load_fn64[mte][be][a->ff][a->xs][a->u][a->msz];
         break;
     }
     assert(fn != NULL);
 
     do_mem_zpz(s, a->rd, a->pg, a->rm, a->scale * a->msz,
-               cpu_reg_sp(s, a->rn), a->msz, fn);
+               cpu_reg_sp(s, a->rn), a->msz, false, fn);
     return true;
 }
 
 static bool trans_LD1_zpiz(DisasContext *s, arg_LD1_zpiz *a)
 {
     gen_helper_gvec_mem_scatter *fn = NULL;
-    int be = s->be_data == MO_BE;
+    bool be = s->be_data == MO_BE;
+    bool mte = s->mte_active[0];
     TCGv_i64 imm;
 
     if (a->esz < a->msz || (a->esz == a->msz && !a->u)) {
@@ -XXX,XX +XXX,XX @@ static bool trans_LD1_zpiz(DisasContext *s, arg_LD1_zpiz *a)
 
     switch (a->esz) {
     case MO_32:
-        fn = gather_load_fn32[be][a->ff][0][a->u][a->msz];
+        fn = gather_load_fn32[mte][be][a->ff][0][a->u][a->msz];
         break;
     case MO_64:
-        fn = gather_load_fn64[be][a->ff][2][a->u][a->msz];
+        fn = gather_load_fn64[mte][be][a->ff][2][a->u][a->msz];
         break;
     }
     assert(fn != NULL);
@@ -XXX,XX +XXX,XX @@ static bool trans_LD1_zpiz(DisasContext *s, arg_LD1_zpiz *a)
      * by loading the immediate into the scalar parameter.
      */
     imm = tcg_const_i64(a->imm << a->msz);
-    do_mem_zpz(s, a->rd, a->pg, a->rn, 0, imm, a->msz, fn);
+    do_mem_zpz(s, a->rd, a->pg, a->rn, 0, imm, a->msz, false, fn);
     tcg_temp_free_i64(imm);
     return true;
 }
 
-/* Indexed by [be][xs][msz].  */
-static gen_helper_gvec_mem_scatter * const scatter_store_fn32[2][2][3] = {
-    /* Little-endian */
-    { { gen_helper_sve_stbs_zsu,
-        gen_helper_sve_sths_le_zsu,
-        gen_helper_sve_stss_le_zsu, },
-      { gen_helper_sve_stbs_zss,
-        gen_helper_sve_sths_le_zss,
-        gen_helper_sve_stss_le_zss, } },
-    /* Big-endian */
-    { { gen_helper_sve_stbs_zsu,
-        gen_helper_sve_sths_be_zsu,
-        gen_helper_sve_stss_be_zsu, },
-      { gen_helper_sve_stbs_zss,
-        gen_helper_sve_sths_be_zss,
-        gen_helper_sve_stss_be_zss, } },
+/* Indexed by [mte][be][xs][msz].  */
+static gen_helper_gvec_mem_scatter * const scatter_store_fn32[2][2][2][3] = {
+    { /* MTE Inactive */
+        { /* Little-endian */
+            { gen_helper_sve_stbs_zsu,
+              gen_helper_sve_sths_le_zsu,
+              gen_helper_sve_stss_le_zsu, },
+            { gen_helper_sve_stbs_zss,
+              gen_helper_sve_sths_le_zss,
+              gen_helper_sve_stss_le_zss, } },
+        { /* Big-endian */
+            { gen_helper_sve_stbs_zsu,
+              gen_helper_sve_sths_be_zsu,
+              gen_helper_sve_stss_be_zsu, },
+            { gen_helper_sve_stbs_zss,
+              gen_helper_sve_sths_be_zss,
+              gen_helper_sve_stss_be_zss, } } },
+    { /* MTE Active */
+        { /* Little-endian */
+            { gen_helper_sve_stbs_zsu_mte,
+              gen_helper_sve_sths_le_zsu_mte,
+              gen_helper_sve_stss_le_zsu_mte, },
+            { gen_helper_sve_stbs_zss_mte,
+              gen_helper_sve_sths_le_zss_mte,
+              gen_helper_sve_stss_le_zss_mte, } },
+        { /* Big-endian */
+            { gen_helper_sve_stbs_zsu_mte,
+              gen_helper_sve_sths_be_zsu_mte,
+              gen_helper_sve_stss_be_zsu_mte, },
+            { gen_helper_sve_stbs_zss_mte,
+              gen_helper_sve_sths_be_zss_mte,
+              gen_helper_sve_stss_be_zss_mte, } } },
 };
 
 /* Note that we overload xs=2 to indicate 64-bit offset.  */
-static gen_helper_gvec_mem_scatter * const scatter_store_fn64[2][3][4] = {
-    /* Little-endian */
-    { { gen_helper_sve_stbd_zsu,
-        gen_helper_sve_sthd_le_zsu,
-        gen_helper_sve_stsd_le_zsu,
-        gen_helper_sve_stdd_le_zsu, },
-      { gen_helper_sve_stbd_zss,
-        gen_helper_sve_sthd_le_zss,
-        gen_helper_sve_stsd_le_zss,
-        gen_helper_sve_stdd_le_zss, },
-      { gen_helper_sve_stbd_zd,
-        gen_helper_sve_sthd_le_zd,
-        gen_helper_sve_stsd_le_zd,
-        gen_helper_sve_stdd_le_zd, } },
-    /* Big-endian */
-    { { gen_helper_sve_stbd_zsu,
-        gen_helper_sve_sthd_be_zsu,
-        gen_helper_sve_stsd_be_zsu,
-        gen_helper_sve_stdd_be_zsu, },
-      { gen_helper_sve_stbd_zss,
-        gen_helper_sve_sthd_be_zss,
-        gen_helper_sve_stsd_be_zss,
-        gen_helper_sve_stdd_be_zss, },
-      { gen_helper_sve_stbd_zd,
-        gen_helper_sve_sthd_be_zd,
-        gen_helper_sve_stsd_be_zd,
-        gen_helper_sve_stdd_be_zd, } },
+static gen_helper_gvec_mem_scatter * const scatter_store_fn64[2][2][3][4] = {
+    { /* MTE Inactive */
+         { /* Little-endian */
+             { gen_helper_sve_stbd_zsu,
+               gen_helper_sve_sthd_le_zsu,
+               gen_helper_sve_stsd_le_zsu,
+               gen_helper_sve_stdd_le_zsu, },
+             { gen_helper_sve_stbd_zss,
+               gen_helper_sve_sthd_le_zss,
+               gen_helper_sve_stsd_le_zss,
+               gen_helper_sve_stdd_le_zss, },
+             { gen_helper_sve_stbd_zd,
+               gen_helper_sve_sthd_le_zd,
+               gen_helper_sve_stsd_le_zd,
+               gen_helper_sve_stdd_le_zd, } },
+         { /* Big-endian */
+             { gen_helper_sve_stbd_zsu,
+               gen_helper_sve_sthd_be_zsu,
+               gen_helper_sve_stsd_be_zsu,
+               gen_helper_sve_stdd_be_zsu, },
+             { gen_helper_sve_stbd_zss,
+               gen_helper_sve_sthd_be_zss,
+               gen_helper_sve_stsd_be_zss,
+               gen_helper_sve_stdd_be_zss, },
+             { gen_helper_sve_stbd_zd,
+               gen_helper_sve_sthd_be_zd,
+               gen_helper_sve_stsd_be_zd,
+               gen_helper_sve_stdd_be_zd, } } },
+    { /* MTE Inactive */
+         { /* Little-endian */
+             { gen_helper_sve_stbd_zsu_mte,
+               gen_helper_sve_sthd_le_zsu_mte,
+               gen_helper_sve_stsd_le_zsu_mte,
+               gen_helper_sve_stdd_le_zsu_mte, },
+             { gen_helper_sve_stbd_zss_mte,
+               gen_helper_sve_sthd_le_zss_mte,
+               gen_helper_sve_stsd_le_zss_mte,
+               gen_helper_sve_stdd_le_zss_mte, },
+             { gen_helper_sve_stbd_zd_mte,
+               gen_helper_sve_sthd_le_zd_mte,
+               gen_helper_sve_stsd_le_zd_mte,
+               gen_helper_sve_stdd_le_zd_mte, } },
+         { /* Big-endian */
+             { gen_helper_sve_stbd_zsu_mte,
+               gen_helper_sve_sthd_be_zsu_mte,
+               gen_helper_sve_stsd_be_zsu_mte,
+               gen_helper_sve_stdd_be_zsu_mte, },
+             { gen_helper_sve_stbd_zss_mte,
+               gen_helper_sve_sthd_be_zss_mte,
+               gen_helper_sve_stsd_be_zss_mte,
+               gen_helper_sve_stdd_be_zss_mte, },
+             { gen_helper_sve_stbd_zd_mte,
+               gen_helper_sve_sthd_be_zd_mte,
+               gen_helper_sve_stsd_be_zd_mte,
+               gen_helper_sve_stdd_be_zd_mte, } } },
 };
 
 static bool trans_ST1_zprz(DisasContext *s, arg_ST1_zprz *a)
 {
     gen_helper_gvec_mem_scatter *fn;
-    int be = s->be_data == MO_BE;
+    bool be = s->be_data == MO_BE;
+    bool mte = s->mte_active[0];
 
     if (a->esz < a->msz || (a->msz == 0 && a->scale)) {
         return false;
@@ -XXX,XX +XXX,XX @@ static bool trans_ST1_zprz(DisasContext *s, arg_ST1_zprz *a)
     }
     switch (a->esz) {
     case MO_32:
-        fn = scatter_store_fn32[be][a->xs][a->msz];
+        fn = scatter_store_fn32[mte][be][a->xs][a->msz];
         break;
     case MO_64:
-        fn = scatter_store_fn64[be][a->xs][a->msz];
+        fn = scatter_store_fn64[mte][be][a->xs][a->msz];
         break;
     default:
         g_assert_not_reached();
     }
     do_mem_zpz(s, a->rd, a->pg, a->rm, a->scale * a->msz,
-               cpu_reg_sp(s, a->rn), a->msz, fn);
+               cpu_reg_sp(s, a->rn), a->msz, true, fn);
     return true;
 }
 
 static bool trans_ST1_zpiz(DisasContext *s, arg_ST1_zpiz *a)
 {
     gen_helper_gvec_mem_scatter *fn = NULL;
-    int be = s->be_data == MO_BE;
+    bool be = s->be_data == MO_BE;
+    bool mte = s->mte_active[0];
     TCGv_i64 imm;
 
     if (a->esz < a->msz) {
@@ -XXX,XX +XXX,XX @@ static bool trans_ST1_zpiz(DisasContext *s, arg_ST1_zpiz *a)
 
     switch (a->esz) {
     case MO_32:
-        fn = scatter_store_fn32[be][0][a->msz];
+        fn = scatter_store_fn32[mte][be][0][a->msz];
         break;
     case MO_64:
-        fn = scatter_store_fn64[be][2][a->msz];
+        fn = scatter_store_fn64[mte][be][2][a->msz];
         break;
     }
     assert(fn != NULL);
@@ -XXX,XX +XXX,XX @@ static bool trans_ST1_zpiz(DisasContext *s, arg_ST1_zpiz *a)
      * by loading the immediate into the scalar parameter.
      */
     imm = tcg_const_i64(a->imm << a->msz);
-    do_mem_zpz(s, a->rd, a->pg, a->rn, 0, imm, a->msz, fn);
+    do_mem_zpz(s, a->rd, a->pg, a->rn, 0, imm, a->msz, true, fn);
     tcg_temp_free_i64(imm);
     return true;
 }
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

There are a number of paths by which the TBI is still intact
for user-only in the SVE helpers.

Because we currently always set TBI for user-only, we do not
need to pass down the actual TBI setting from above, and we
can remove the top byte in the inner-most primitives, so that
none are forgotten.  Moreover, this keeps the "dirty" pointer
around at the higher levels, where we need it for any MTE checking.

Since the normal case, especially for user-only, goes through
RAM, this clearing merely adds two insns per page lookup, which
will be completely in the noise.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-39-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.c           |  3 +++
 target/arm/sve_helper.c    | 19 +++++++++++++++++--
 target/arm/translate-a64.c |  5 +++++
 3 files changed, 25 insertions(+), 2 deletions(-)

diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_reset(DeviceState *dev)
          * Enable TBI0 and TBI1.  While the real kernel only enables TBI0,
          * turning on both here will produce smaller code and otherwise
          * make no difference to the user-level emulation.
+         *
+         * In sve_probe_page, we assume that this is set.
+         * Do not modify this without other changes.
          */
         env->cp15.tcr_el[1].raw_tcr = (3ULL << 37);
 #else
diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve_helper.c
+++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ static void sve_##NAME##_host(void *vd, intptr_t reg_off, void *host)  \
 static void sve_##NAME##_tlb(CPUARMState *env, void *vd, intptr_t reg_off,  \
                              target_ulong addr, uintptr_t ra)               \
 {                                                                           \
-    *(TYPEE *)(vd + H(reg_off)) = (TYPEM)TLB(env, addr, ra);                \
+    *(TYPEE *)(vd + H(reg_off)) =                                           \
+        (TYPEM)TLB(env, useronly_clean_ptr(addr), ra);                      \
 }
 
 #define DO_ST_TLB(NAME, H, TYPEE, TYPEM, TLB) \
 static void sve_##NAME##_tlb(CPUARMState *env, void *vd, intptr_t reg_off,  \
                              target_ulong addr, uintptr_t ra)               \
 {                                                                           \
-    TLB(env, addr, (TYPEM)*(TYPEE *)(vd + H(reg_off)), ra);                 \
+    TLB(env, useronly_clean_ptr(addr),                                      \
+        (TYPEM)*(TYPEE *)(vd + H(reg_off)), ra);                            \
 }
 
 #define DO_LD_PRIM_1(NAME, H, TE, TM)                   \
@@ -XXX,XX +XXX,XX @@ static bool sve_probe_page(SVEHostPage *info, bool nofault,
     int flags;
 
     addr += mem_off;
+
+    /*
+     * User-only currently always issues with TBI.  See the comment
+     * above useronly_clean_ptr.  Usually we clean this top byte away
+     * during translation, but we can't do that for e.g. vector + imm
+     * addressing modes.
+     *
+     * We currently always enable TBI for user-only, and do not provide
+     * a way to turn it off.  So clean the pointer unconditionally here,
+     * rather than look it up here, or pass it down from above.
+     */
+    addr = useronly_clean_ptr(addr);
+
     flags = probe_access_flags(env, addr, access_type, mmu_idx, nofault,
                                &info->host, retaddr);
     info->flags = flags;
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_tr_init_disas_context(DisasContextBase *dcbase,
     dc->features = env->features;
     dc->dcz_blocksize = arm_cpu->dcz_blocksize;
 
+#ifdef CONFIG_USER_ONLY
+    /* In sve_probe_page, we assume TBI is enabled. */
+    tcg_debug_assert(dc->tbid & 1);
+#endif
+
     /* Single step state. The code-generation logic here is:
      *  SS_ACTIVE == 0:
      *   generate code with no special handling for single-stepping (except
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

This is DC GVA and DC GZVA, and the tag check for DC ZVA.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-40-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h           |  4 +++-
 target/arm/helper.c        | 16 ++++++++++++++++
 target/arm/translate-a64.c | 39 ++++++++++++++++++++++++++++++++++++++
 3 files changed, 58 insertions(+), 1 deletion(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ static inline uint64_t cpreg_to_kvm_id(uint32_t cpregid)
 #define ARM_CP_NZCV              (ARM_CP_SPECIAL | 0x0300)
 #define ARM_CP_CURRENTEL         (ARM_CP_SPECIAL | 0x0400)
 #define ARM_CP_DC_ZVA            (ARM_CP_SPECIAL | 0x0500)
-#define ARM_LAST_SPECIAL         ARM_CP_DC_ZVA
+#define ARM_CP_DC_GVA            (ARM_CP_SPECIAL | 0x0600)
+#define ARM_CP_DC_GZVA           (ARM_CP_SPECIAL | 0x0700)
+#define ARM_LAST_SPECIAL         ARM_CP_DC_GZVA
 #define ARM_CP_FPU               0x1000
 #define ARM_CP_SVE               0x2000
 #define ARM_CP_NO_GDB            0x4000
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo mte_el0_cacheop_reginfo[] = {
       .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 14, .opc2 = 5,
       .type = ARM_CP_NOP, .access = PL0_W,
       .accessfn = aa64_cacheop_poc_access },
+    { .name = "DC_GVA", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 4, .opc2 = 3,
+      .access = PL0_W, .type = ARM_CP_DC_GVA,
+#ifndef CONFIG_USER_ONLY
+      /* Avoid overhead of an access check that always passes in user-mode */
+      .accessfn = aa64_zva_access,
+#endif
+    },
+    { .name = "DC_GZVA", .state = ARM_CP_STATE_AA64,
+      .opc0 = 1, .opc1 = 3, .crn = 7, .crm = 4, .opc2 = 4,
+      .access = PL0_W, .type = ARM_CP_DC_GZVA,
+#ifndef CONFIG_USER_ONLY
+      /* Avoid overhead of an access check that always passes in user-mode */
+      .accessfn = aa64_zva_access,
+#endif
+    },
     REGINFO_SENTINEL
 };
 
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void handle_sys(DisasContext *s, uint32_t insn, bool isread,
         }
         gen_helper_dc_zva(cpu_env, tcg_rt);
         return;
+    case ARM_CP_DC_GVA:
+        {
+            TCGv_i64 clean_addr, tag;
+
+            /*
+             * DC_GVA, like DC_ZVA, requires that we supply the original
+             * pointer for an invalid page.  Probe that address first.
+             */
+            tcg_rt = cpu_reg(s, rt);
+            clean_addr = clean_data_tbi(s, tcg_rt);
+            gen_probe_access(s, clean_addr, MMU_DATA_STORE, MO_8);
+
+            if (s->ata) {
+                /* Extract the tag from the register to match STZGM.  */
+                tag = tcg_temp_new_i64();
+                tcg_gen_shri_i64(tag, tcg_rt, 56);
+                gen_helper_stzgm_tags(cpu_env, clean_addr, tag);
+                tcg_temp_free_i64(tag);
+            }
+        }
+        return;
+    case ARM_CP_DC_GZVA:
+        {
+            TCGv_i64 clean_addr, tag;
+
+            /* For DC_GZVA, we can rely on DC_ZVA for the proper fault. */
+            tcg_rt = cpu_reg(s, rt);
+            clean_addr = clean_data_tbi(s, tcg_rt);
+            gen_helper_dc_zva(cpu_env, clean_addr);
+
+            if (s->ata) {
+                /* Extract the tag from the register to match STZGM.  */
+                tag = tcg_temp_new_i64();
+                tcg_gen_shri_i64(tag, tcg_rt, 56);
+                gen_helper_stzgm_tags(cpu_env, clean_addr, tag);
+                tcg_temp_free_i64(tag);
+            }
+        }
+        return;
     default:
         break;
     }
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

We need to check the memattr of a page in order to determine
whether it is Tagged for MTE.  Between Stage1 and Stage2,
this becomes simpler if we always collect this data, instead
of occasionally being presented with NULL.

Use the nonnull attribute to allow the compiler to check that
all pointer arguments are non-null.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-42-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/internals.h  |  3 ++-
 target/arm/helper.c     | 60 ++++++++++++++++++++---------------------
 target/arm/m_helper.c   | 11 +++++---
 target/arm/tlb_helper.c |  4 ++-
 4 files changed, 42 insertions(+), 36 deletions(-)

diff --git a/target/arm/internals.h b/target/arm/internals.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/internals.h
+++ b/target/arm/internals.h
@@ -XXX,XX +XXX,XX @@ bool get_phys_addr(CPUARMState *env, target_ulong address,
                    MMUAccessType access_type, ARMMMUIdx mmu_idx,
                    hwaddr *phys_ptr, MemTxAttrs *attrs, int *prot,
                    target_ulong *page_size,
-                   ARMMMUFaultInfo *fi, ARMCacheAttrs *cacheattrs);
+                   ARMMMUFaultInfo *fi, ARMCacheAttrs *cacheattrs)
+    __attribute__((nonnull));
 
 void arm_log_exception(int idx);
 
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static bool get_phys_addr_lpae(CPUARMState *env, target_ulong address,
                                bool s1_is_el0,
                                hwaddr *phys_ptr, MemTxAttrs *txattrs, int *prot,
                                target_ulong *page_size_ptr,
-                               ARMMMUFaultInfo *fi, ARMCacheAttrs *cacheattrs);
+                               ARMMMUFaultInfo *fi, ARMCacheAttrs *cacheattrs)
+    __attribute__((nonnull));
 #endif
 
 static void switch_mode(CPUARMState *env, int mode);
@@ -XXX,XX +XXX,XX @@ static bool get_phys_addr_lpae(CPUARMState *env, target_ulong address,
         arm_tlb_bti_gp(txattrs) = true;
     }
 
-    if (cacheattrs != NULL) {
-        if (mmu_idx == ARMMMUIdx_Stage2) {
-            cacheattrs->attrs = convert_stage2_attrs(env,
-                                                     extract32(attrs, 0, 4));
-        } else {
-            /* Index into MAIR registers for cache attributes */
-            uint8_t attrindx = extract32(attrs, 0, 3);
-            uint64_t mair = env->cp15.mair_el[regime_el(env, mmu_idx)];
-            assert(attrindx <= 7);
-            cacheattrs->attrs = extract64(mair, attrindx * 8, 8);
-        }
-        cacheattrs->shareability = extract32(attrs, 6, 2);
+    if (mmu_idx == ARMMMUIdx_Stage2) {
+        cacheattrs->attrs = convert_stage2_attrs(env, extract32(attrs, 0, 4));
+    } else {
+        /* Index into MAIR registers for cache attributes */
+        uint8_t attrindx = extract32(attrs, 0, 3);
+        uint64_t mair = env->cp15.mair_el[regime_el(env, mmu_idx)];
+        assert(attrindx <= 7);
+        cacheattrs->attrs = extract64(mair, attrindx * 8, 8);
     }
+    cacheattrs->shareability = extract32(attrs, 6, 2);
 
     *phys_ptr = descaddr;
     *page_size_ptr = page_size;
@@ -XXX,XX +XXX,XX @@ bool get_phys_addr(CPUARMState *env, target_ulong address,
             ret = get_phys_addr_lpae(env, ipa, access_type, ARMMMUIdx_Stage2,
                                      mmu_idx == ARMMMUIdx_E10_0,
                                      phys_ptr, attrs, &s2_prot,
-                                     page_size, fi,
-                                     cacheattrs != NULL ? &cacheattrs2 : NULL);
+                                     page_size, fi, &cacheattrs2);
             fi->s2addr = ipa;
             /* Combine the S1 and S2 perms.  */
             *prot &= s2_prot;
 
-            /* Combine the S1 and S2 cache attributes, if needed */
-            if (!ret && cacheattrs != NULL) {
-                if (env->cp15.hcr_el2 & HCR_DC) {
-                    /*
-                     * HCR.DC forces the first stage attributes to
-                     *  Normal Non-Shareable,
-                     *  Inner Write-Back Read-Allocate Write-Allocate,
-                     *  Outer Write-Back Read-Allocate Write-Allocate.
-                     */
-                    cacheattrs->attrs = 0xff;
-                    cacheattrs->shareability = 0;
-                }
-                *cacheattrs = combine_cacheattrs(*cacheattrs, cacheattrs2);
+            /* If S2 fails, return early.  */
+            if (ret) {
+                return ret;
             }
 
-            return ret;
+            /* Combine the S1 and S2 cache attributes. */
+            if (env->cp15.hcr_el2 & HCR_DC) {
+                /*
+                 * HCR.DC forces the first stage attributes to
+                 *  Normal Non-Shareable,
+                 *  Inner Write-Back Read-Allocate Write-Allocate,
+                 *  Outer Write-Back Read-Allocate Write-Allocate.
+                 */
+                cacheattrs->attrs = 0xff;
+                cacheattrs->shareability = 0;
+            }
+            *cacheattrs = combine_cacheattrs(*cacheattrs, cacheattrs2);
+            return 0;
         } else {
             /*
              * For non-EL2 CPUs a stage1+stage2 translation is just stage 1.
@@ -XXX,XX +XXX,XX @@ hwaddr arm_cpu_get_phys_page_attrs_debug(CPUState *cs, vaddr addr,
     bool ret;
     ARMMMUFaultInfo fi = {};
     ARMMMUIdx mmu_idx = arm_mmu_idx(env);
+    ARMCacheAttrs cacheattrs = {};
 
     *attrs = (MemTxAttrs) {};
 
     ret = get_phys_addr(env, addr, 0, mmu_idx, &phys_addr,
-                        attrs, &prot, &page_size, &fi, NULL);
+                        attrs, &prot, &page_size, &fi, &cacheattrs);
 
     if (ret) {
         return -1;
diff --git a/target/arm/m_helper.c b/target/arm/m_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/m_helper.c
+++ b/target/arm/m_helper.c
@@ -XXX,XX +XXX,XX @@ static bool v7m_stack_write(ARMCPU *cpu, uint32_t addr, uint32_t value,
     hwaddr physaddr;
     int prot;
     ARMMMUFaultInfo fi = {};
+    ARMCacheAttrs cacheattrs = {};
     bool secure = mmu_idx & ARM_MMU_IDX_M_S;
     int exc;
     bool exc_secure;
 
     if (get_phys_addr(env, addr, MMU_DATA_STORE, mmu_idx, &physaddr,
-                      &attrs, &prot, &page_size, &fi, NULL)) {
+                      &attrs, &prot, &page_size, &fi, &cacheattrs)) {
         /* MPU/SAU lookup failed */
         if (fi.type == ARMFault_QEMU_SFault) {
             if (mode == STACK_LAZYFP) {
@@ -XXX,XX +XXX,XX @@ static bool v7m_stack_read(ARMCPU *cpu, uint32_t *dest, uint32_t addr,
     hwaddr physaddr;
     int prot;
     ARMMMUFaultInfo fi = {};
+    ARMCacheAttrs cacheattrs = {};
     bool secure = mmu_idx & ARM_MMU_IDX_M_S;
     int exc;
     bool exc_secure;
     uint32_t value;
 
     if (get_phys_addr(env, addr, MMU_DATA_LOAD, mmu_idx, &physaddr,
-                      &attrs, &prot, &page_size, &fi, NULL)) {
+                      &attrs, &prot, &page_size, &fi, &cacheattrs)) {
         /* MPU/SAU lookup failed */
         if (fi.type == ARMFault_QEMU_SFault) {
             qemu_log_mask(CPU_LOG_INT,
@@ -XXX,XX +XXX,XX @@ static bool v7m_read_half_insn(ARMCPU *cpu, ARMMMUIdx mmu_idx,
     V8M_SAttributes sattrs = {};
     MemTxAttrs attrs = {};
     ARMMMUFaultInfo fi = {};
+    ARMCacheAttrs cacheattrs = {};
     MemTxResult txres;
     target_ulong page_size;
     hwaddr physaddr;
@@ -XXX,XX +XXX,XX @@ static bool v7m_read_half_insn(ARMCPU *cpu, ARMMMUIdx mmu_idx,
                       "...really SecureFault with SFSR.INVEP\n");
         return false;
     }
-    if (get_phys_addr(env, addr, MMU_INST_FETCH, mmu_idx,
-                      &physaddr, &attrs, &prot, &page_size, &fi, NULL)) {
+    if (get_phys_addr(env, addr, MMU_INST_FETCH, mmu_idx, &physaddr,
+                      &attrs, &prot, &page_size, &fi, &cacheattrs)) {
         /* the MPU lookup failed */
         env->v7m.cfsr[env->v7m.secure] |= R_V7M_CFSR_IACCVIOL_MASK;
         armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_MEM, env->v7m.secure);
diff --git a/target/arm/tlb_helper.c b/target/arm/tlb_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/tlb_helper.c
+++ b/target/arm/tlb_helper.c
@@ -XXX,XX +XXX,XX @@ bool arm_cpu_tlb_fill(CPUState *cs, vaddr address, int size,
     int prot, ret;
     MemTxAttrs attrs = {};
     ARMMMUFaultInfo fi = {};
+    ARMCacheAttrs cacheattrs = {};
 
     /*
      * Walk the page table and (if the mapping exists) add the page
@@ -XXX,XX +XXX,XX @@ bool arm_cpu_tlb_fill(CPUState *cs, vaddr address, int size,
      */
     ret = get_phys_addr(&cpu->env, address, access_type,
                         core_to_arm_mmu_idx(&cpu->env, mmu_idx),
-                        &phys_addr, &attrs, &prot, &page_size, &fi, NULL);
+                        &phys_addr, &attrs, &prot, &page_size,
+                        &fi, &cacheattrs);
     if (likely(!ret)) {
         /*
          * Map a single [sub]page. Regions smaller than our declared
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

This "bit" is a particular value of the page's MemAttr.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-43-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper.c     | 48 ++++++++++++++++++++++++++++++++++++++---
 target/arm/tlb_helper.c |  5 +++++
 2 files changed, 50 insertions(+), 3 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static uint8_t combine_cacheattr_nibble(uint8_t s1, uint8_t s2)
  */
 static ARMCacheAttrs combine_cacheattrs(ARMCacheAttrs s1, ARMCacheAttrs s2)
 {
-    uint8_t s1lo = extract32(s1.attrs, 0, 4), s2lo = extract32(s2.attrs, 0, 4);
-    uint8_t s1hi = extract32(s1.attrs, 4, 4), s2hi = extract32(s2.attrs, 4, 4);
+    uint8_t s1lo, s2lo, s1hi, s2hi;
     ARMCacheAttrs ret;
+    bool tagged = false;
+
+    if (s1.attrs == 0xf0) {
+        tagged = true;
+        s1.attrs = 0xff;
+    }
+
+    s1lo = extract32(s1.attrs, 0, 4);
+    s2lo = extract32(s2.attrs, 0, 4);
+    s1hi = extract32(s1.attrs, 4, 4);
+    s2hi = extract32(s2.attrs, 4, 4);
 
     /* Combine shareability attributes (table D4-43) */
     if (s1.shareability == 2 || s2.shareability == 2) {
@@ -XXX,XX +XXX,XX @@ static ARMCacheAttrs combine_cacheattrs(ARMCacheAttrs s1, ARMCacheAttrs s2)
         }
     }
 
+    /* TODO: CombineS1S2Desc does not consider transient, only WB, RWA. */
+    if (tagged && ret.attrs == 0xff) {
+        ret.attrs = 0xf0;
+    }
+
     return ret;
 }
 
@@ -XXX,XX +XXX,XX @@ bool get_phys_addr(CPUARMState *env, target_ulong address,
                  *  Normal Non-Shareable,
                  *  Inner Write-Back Read-Allocate Write-Allocate,
                  *  Outer Write-Back Read-Allocate Write-Allocate.
+                 * Do not overwrite Tagged within attrs.
                  */
-                cacheattrs->attrs = 0xff;
+                if (cacheattrs->attrs != 0xf0) {
+                    cacheattrs->attrs = 0xff;
+                }
                 cacheattrs->shareability = 0;
             }
             *cacheattrs = combine_cacheattrs(*cacheattrs, cacheattrs2);
@@ -XXX,XX +XXX,XX @@ bool get_phys_addr(CPUARMState *env, target_ulong address,
     /* Definitely a real MMU, not an MPU */
 
     if (regime_translation_disabled(env, mmu_idx)) {
+        uint64_t hcr;
+        uint8_t memattr;
+
         /*
          * MMU disabled.  S1 addresses within aa64 translation regimes are
          * still checked for bounds -- see AArch64.TranslateAddressS1Off.
@@ -XXX,XX +XXX,XX @@ bool get_phys_addr(CPUARMState *env, target_ulong address,
         *phys_ptr = address;
         *prot = PAGE_READ | PAGE_WRITE | PAGE_EXEC;
         *page_size = TARGET_PAGE_SIZE;
+
+        /* Fill in cacheattr a-la AArch64.TranslateAddressS1Off. */
+        hcr = arm_hcr_el2_eff(env);
+        cacheattrs->shareability = 0;
+        if (hcr & HCR_DC) {
+            if (hcr & HCR_DCT) {
+                memattr = 0xf0;  /* Tagged, Normal, WB, RWA */
+            } else {
+                memattr = 0xff;  /* Normal, WB, RWA */
+            }
+        } else if (access_type == MMU_INST_FETCH) {
+            if (regime_sctlr(env, mmu_idx) & SCTLR_I) {
+                memattr = 0xee;  /* Normal, WT, RA, NT */
+            } else {
+                memattr = 0x44;  /* Normal, NC, No */
+            }
+            cacheattrs->shareability = 2; /* outer sharable */
+        } else {
+            memattr = 0x00;      /* Device, nGnRnE */
+        }
+        cacheattrs->attrs = memattr;
         return 0;
     }
 
diff --git a/target/arm/tlb_helper.c b/target/arm/tlb_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/tlb_helper.c
+++ b/target/arm/tlb_helper.c
@@ -XXX,XX +XXX,XX @@ bool arm_cpu_tlb_fill(CPUState *cs, vaddr address, int size,
             phys_addr &= TARGET_PAGE_MASK;
             address &= TARGET_PAGE_MASK;
         }
+        /* Notice and record tagged memory. */
+        if (cpu_isar_feature(aa64_mte, cpu) && cacheattrs.attrs == 0xf0) {
+            arm_tlb_mte_tagged(&attrs) = true;
+        }
+
         tlb_set_page_with_attrs(cs, address, phys_addr, attrs,
                                 prot, mmu_idx, page_size);
         return true;
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20200626033144.790098-44-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h |  6 ++++++
 hw/arm/virt.c    | 55 ++++++++++++++++++++++++++++++++++++++++++++++--
 target/arm/cpu.c | 52 +++++++++++++++++++++++++++++++++++++++++----
 3 files changed, 107 insertions(+), 6 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ struct ARMCPU {
     /* MemoryRegion to use for secure physical accesses */
     MemoryRegion *secure_memory;
 
+    /* MemoryRegion to use for allocation tag accesses */
+    MemoryRegion *tag_memory;
+    MemoryRegion *secure_tag_memory;
+
     /* For v8M, pointer to the IDAU interface provided by board/SoC */
     Object *idau;
 
@@ -XXX,XX +XXX,XX @@ typedef enum ARMMMUIdxBit {
 typedef enum ARMASIdx {
     ARMASIdx_NS = 0,
     ARMASIdx_S = 1,
+    ARMASIdx_TagNS = 2,
+    ARMASIdx_TagS = 3,
 } ARMASIdx;
 
 /* Return the Exception Level targeted by debug exceptions. */
diff --git a/hw/arm/virt.c b/hw/arm/virt.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/virt.c
+++ b/hw/arm/virt.c
@@ -XXX,XX +XXX,XX @@ static void create_platform_bus(VirtMachineState *vms)
                                 sysbus_mmio_get_region(s, 0));
 }
 
+static void create_tag_ram(MemoryRegion *tag_sysmem,
+                           hwaddr base, hwaddr size,
+                           const char *name)
+{
+    MemoryRegion *tagram = g_new(MemoryRegion, 1);
+
+    memory_region_init_ram(tagram, NULL, name, size / 32, &error_fatal);
+    memory_region_add_subregion(tag_sysmem, base / 32, tagram);
+}
+
 static void create_secure_ram(VirtMachineState *vms,
-                              MemoryRegion *secure_sysmem)
+                              MemoryRegion *secure_sysmem,
+                              MemoryRegion *secure_tag_sysmem)
 {
     MemoryRegion *secram = g_new(MemoryRegion, 1);
     char *nodename;
@@ -XXX,XX +XXX,XX @@ static void create_secure_ram(VirtMachineState *vms,
     qemu_fdt_setprop_string(vms->fdt, nodename, "status", "disabled");
     qemu_fdt_setprop_string(vms->fdt, nodename, "secure-status", "okay");
 
+    if (secure_tag_sysmem) {
+        create_tag_ram(secure_tag_sysmem, base, size, "mach-virt.secure-tag");
+    }
+
     g_free(nodename);
 }
 
@@ -XXX,XX +XXX,XX @@ static void machvirt_init(MachineState *machine)
     const CPUArchIdList *possible_cpus;
     MemoryRegion *sysmem = get_system_memory();
     MemoryRegion *secure_sysmem = NULL;
+    MemoryRegion *tag_sysmem = NULL;
+    MemoryRegion *secure_tag_sysmem = NULL;
     int n, virt_max_cpus;
     bool firmware_loaded;
     bool aarch64 = true;
@@ -XXX,XX +XXX,XX @@ static void machvirt_init(MachineState *machine)
                                      "secure-memory", &error_abort);
         }
 
+        /*
+         * The cpu adds the property if and only if MemTag is supported.
+         * If it is, we must allocate the ram to back that up.
+         */
+        if (object_property_find(cpuobj, "tag-memory", NULL)) {
+            if (!tag_sysmem) {
+                tag_sysmem = g_new(MemoryRegion, 1);
+                memory_region_init(tag_sysmem, OBJECT(machine),
+                                   "tag-memory", UINT64_MAX / 32);
+
+                if (vms->secure) {
+                    secure_tag_sysmem = g_new(MemoryRegion, 1);
+                    memory_region_init(secure_tag_sysmem, OBJECT(machine),
+                                       "secure-tag-memory", UINT64_MAX / 32);
+
+                    /* As with ram, secure-tag takes precedence over tag.  */
+                    memory_region_add_subregion_overlap(secure_tag_sysmem, 0,
+                                                        tag_sysmem, -1);
+                }
+            }
+
+            object_property_set_link(cpuobj, OBJECT(tag_sysmem),
+                                     "tag-memory", &error_abort);
+            if (vms->secure) {
+                object_property_set_link(cpuobj, OBJECT(secure_tag_sysmem),
+                                         "secure-tag-memory", &error_abort);
+            }
+        }
+
         qdev_realize(DEVICE(cpuobj), NULL, &error_fatal);
         object_unref(cpuobj);
     }
@@ -XXX,XX +XXX,XX @@ static void machvirt_init(MachineState *machine)
     create_uart(vms, VIRT_UART, sysmem, serial_hd(0));
 
     if (vms->secure) {
-        create_secure_ram(vms, secure_sysmem);
+        create_secure_ram(vms, secure_sysmem, secure_tag_sysmem);
         create_uart(vms, VIRT_SECURE_UART, secure_sysmem, serial_hd(1));
     }
 
+    if (tag_sysmem) {
+        create_tag_ram(tag_sysmem, vms->memmap[VIRT_MEM].base,
+                       machine->ram_size, "mach-virt.tag");
+    }
+
     vms->highmem_ecam &= vms->highmem && (!firmware_loaded || aarch64);
 
     create_rtc(vms);
diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ void arm_cpu_post_init(Object *obj)
     if (kvm_enabled()) {
         kvm_arm_add_vcpu_properties(obj);
     }
+
+#ifndef CONFIG_USER_ONLY
+    if (arm_feature(&cpu->env, ARM_FEATURE_AARCH64) &&
+        cpu_isar_feature(aa64_mte, cpu)) {
+        object_property_add_link(obj, "tag-memory",
+                                 TYPE_MEMORY_REGION,
+                                 (Object **)&cpu->tag_memory,
+                                 qdev_prop_allow_set_link_before_realize,
+                                 OBJ_PROP_LINK_STRONG);
+
+        if (arm_feature(&cpu->env, ARM_FEATURE_EL3)) {
+            object_property_add_link(obj, "secure-tag-memory",
+                                     TYPE_MEMORY_REGION,
+                                     (Object **)&cpu->secure_tag_memory,
+                                     qdev_prop_allow_set_link_before_realize,
+                                     OBJ_PROP_LINK_STRONG);
+        }
+    }
+#endif
 }
 
 static void arm_cpu_finalizefn(Object *obj)
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
 #ifndef CONFIG_USER_ONLY
     MachineState *ms = MACHINE(qdev_get_machine());
     unsigned int smp_cpus = ms->smp.cpus;
+    bool has_secure = cpu->has_el3 || arm_feature(env, ARM_FEATURE_M_SECURITY);
 
-    if (cpu->has_el3 || arm_feature(env, ARM_FEATURE_M_SECURITY)) {
-        cs->num_ases = 2;
+    /*
+     * We must set cs->num_ases to the final value before
+     * the first call to cpu_address_space_init.
+     */
+    if (cpu->tag_memory != NULL) {
+        cs->num_ases = 3 + has_secure;
+    } else {
+        cs->num_ases = 1 + has_secure;
+    }
 
+    if (has_secure) {
         if (!cpu->secure_memory) {
             cpu->secure_memory = cs->memory;
         }
         cpu_address_space_init(cs, ARMASIdx_S, "cpu-secure-memory",
                                cpu->secure_memory);
-    } else {
-        cs->num_ases = 1;
     }
+
+    if (cpu->tag_memory != NULL) {
+        cpu_address_space_init(cs, ARMASIdx_TagNS, "cpu-tag-memory",
+                               cpu->tag_memory);
+        if (has_secure) {
+            cpu_address_space_init(cs, ARMASIdx_TagS, "cpu-tag-memory",
+                                   cpu->secure_tag_memory);
+        }
+    } else if (cpu_isar_feature(aa64_mte, cpu)) {
+        /*
+         * Since there is no tag memory, we can't meaningfully support MTE
+         * to its fullest.  To avoid problems later, when we would come to
+         * use the tag memory, downgrade support to insns only.
+         */
+        cpu->isar.id_aa64pfr1 =
+            FIELD_DP64(cpu->isar.id_aa64pfr1, ID_AA64PFR1, MTE, 1);
+    }
+
     cpu_address_space_init(cs, ARMASIdx_NS, "cpu-memory", cs->memory);
 
     /* No core_count specified, default to smp_cpus. */
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

Look up the physical address for the given virtual address,
convert that to a tag physical address, and finally return
the host address that backs it.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-45-richard.henderson@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/mte_helper.c | 131 ++++++++++++++++++++++++++++++++++++++++
 1 file changed, 131 insertions(+)

diff --git a/target/arm/mte_helper.c b/target/arm/mte_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/mte_helper.c
+++ b/target/arm/mte_helper.c
@@ -XXX,XX +XXX,XX @@
 #include "cpu.h"
 #include "internals.h"
 #include "exec/exec-all.h"
+#include "exec/ram_addr.h"
 #include "exec/cpu_ldst.h"
 #include "exec/helper-proto.h"
 
@@ -XXX,XX +XXX,XX @@ static uint8_t *allocation_tag_mem(CPUARMState *env, int ptr_mmu_idx,
                                    int ptr_size, MMUAccessType tag_access,
                                    int tag_size, uintptr_t ra)
 {
+#ifdef CONFIG_USER_ONLY
     /* Tag storage not implemented.  */
     return NULL;
+#else
+    uintptr_t index;
+    CPUIOTLBEntry *iotlbentry;
+    int in_page, flags;
+    ram_addr_t ptr_ra;
+    hwaddr ptr_paddr, tag_paddr, xlat;
+    MemoryRegion *mr;
+    ARMASIdx tag_asi;
+    AddressSpace *tag_as;
+    void *host;
+
+    /*
+     * Probe the first byte of the virtual address.  This raises an
+     * exception for inaccessible pages, and resolves the virtual address
+     * into the softmmu tlb.
+     *
+     * When RA == 0, this is for mte_probe1.  The page is expected to be
+     * valid.  Indicate to probe_access_flags no-fault, then assert that
+     * we received a valid page.
+     */
+    flags = probe_access_flags(env, ptr, ptr_access, ptr_mmu_idx,
+                               ra == 0, &host, ra);
+    assert(!(flags & TLB_INVALID_MASK));
+
+    /*
+     * Find the iotlbentry for ptr.  This *must* be present in the TLB
+     * because we just found the mapping.
+     * TODO: Perhaps there should be a cputlb helper that returns a
+     * matching tlb entry + iotlb entry.
+     */
+    index = tlb_index(env, ptr_mmu_idx, ptr);
+# ifdef CONFIG_DEBUG_TCG
+    {
+        CPUTLBEntry *entry = tlb_entry(env, ptr_mmu_idx, ptr);
+        target_ulong comparator = (ptr_access == MMU_DATA_LOAD
+                                   ? entry->addr_read
+                                   : tlb_addr_write(entry));
+        g_assert(tlb_hit(comparator, ptr));
+    }
+# endif
+    iotlbentry = &env_tlb(env)->d[ptr_mmu_idx].iotlb[index];
+
+    /* If the virtual page MemAttr != Tagged, access unchecked. */
+    if (!arm_tlb_mte_tagged(&iotlbentry->attrs)) {
+        return NULL;
+    }
+
+    /*
+     * If not backed by host ram, there is no tag storage: access unchecked.
+     * This is probably a guest os bug though, so log it.
+     */
+    if (unlikely(flags & TLB_MMIO)) {
+        qemu_log_mask(LOG_GUEST_ERROR,
+                      "Page @ 0x%" PRIx64 " indicates Tagged Normal memory "
+                      "but is not backed by host ram\n", ptr);
+        return NULL;
+    }
+
+    /*
+     * The Normal memory access can extend to the next page.  E.g. a single
+     * 8-byte access to the last byte of a page will check only the last
+     * tag on the first page.
+     * Any page access exception has priority over tag check exception.
+     */
+    in_page = -(ptr | TARGET_PAGE_MASK);
+    if (unlikely(ptr_size > in_page)) {
+        void *ignore;
+        flags |= probe_access_flags(env, ptr + in_page, ptr_access,
+                                    ptr_mmu_idx, ra == 0, &ignore, ra);
+        assert(!(flags & TLB_INVALID_MASK));
+    }
+
+    /* Any debug exception has priority over a tag check exception. */
+    if (unlikely(flags & TLB_WATCHPOINT)) {
+        int wp = ptr_access == MMU_DATA_LOAD ? BP_MEM_READ : BP_MEM_WRITE;
+        assert(ra != 0);
+        cpu_check_watchpoint(env_cpu(env), ptr, ptr_size,
+                             iotlbentry->attrs, wp, ra);
+    }
+
+    /*
+     * Find the physical address within the normal mem space.
+     * The memory region lookup must succeed because TLB_MMIO was
+     * not set in the cputlb lookup above.
+     */
+    mr = memory_region_from_host(host, &ptr_ra);
+    tcg_debug_assert(mr != NULL);
+    tcg_debug_assert(memory_region_is_ram(mr));
+    ptr_paddr = ptr_ra;
+    do {
+        ptr_paddr += mr->addr;
+        mr = mr->container;
+    } while (mr);
+
+    /* Convert to the physical address in tag space.  */
+    tag_paddr = ptr_paddr >> (LOG2_TAG_GRANULE + 1);
+
+    /* Look up the address in tag space. */
+    tag_asi = iotlbentry->attrs.secure ? ARMASIdx_TagS : ARMASIdx_TagNS;
+    tag_as = cpu_get_address_space(env_cpu(env), tag_asi);
+    mr = address_space_translate(tag_as, tag_paddr, &xlat, NULL,
+                                 tag_access == MMU_DATA_STORE,
+                                 iotlbentry->attrs);
+
+    /*
+     * Note that @mr will never be NULL.  If there is nothing in the address
+     * space at @tag_paddr, the translation will return the unallocated memory
+     * region.  For our purposes, the result must be ram.
+     */
+    if (unlikely(!memory_region_is_ram(mr))) {
+        /* ??? Failure is a board configuration error. */
+        qemu_log_mask(LOG_UNIMP,
+                      "Tag Memory @ 0x%" HWADDR_PRIx " not found for "
+                      "Normal Memory @ 0x%" HWADDR_PRIx "\n",
+                      tag_paddr, ptr_paddr);
+        return NULL;
+    }
+
+    /*
+     * Ensure the tag memory is dirty on write, for migration.
+     * Tag memory can never contain code or display memory (vga).
+     */
+    if (tag_access == MMU_DATA_STORE) {
+        ram_addr_t tag_ra = memory_region_get_ram_addr(mr) + xlat;
+        cpu_physical_memory_set_dirty_flag(tag_ra, DIRTY_MEMORY_MIGRATION);
+    }
+
+    return memory_region_get_ram_ptr(mr) + xlat;
+#endif
 }
 
 uint64_t HELPER(irg)(CPUARMState *env, uint64_t rn, uint64_t rm)
-- 
2.20.1

From: Richard Henderson <richard.henderson@linaro.org>

We now implement all of the components of MTE, without actually
supporting any tagged memory.  All MTE instructions will work,
trivially, so we can enable support.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20200626033144.790098-46-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu64.c | 5 +++++
 1 file changed, 5 insertions(+)

diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu64.c
+++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
 
         t = cpu->isar.id_aa64pfr1;
         t = FIELD_DP64(t, ID_AA64PFR1, BT, 1);
+        /*
+         * Begin with full support for MTE; will be downgraded to MTE=1
+         * during realize if the board provides no tag memory.
+         */
+        t = FIELD_DP64(t, ID_AA64PFR1, MTE, 2);
         cpu->isar.id_aa64pfr1 = t;
 
         t = cpu->isar.id_aa64mmfr1;
-- 
2.20.1

First arm pullreq of the cycle; this is mostly my softfloat NaN
handling series. (Lots more in my to-review queue, but I don't
like pullreqs growing too close to a hundred patches at a time :-))

thanks
-- PMM

The following changes since commit 97f2796a3736ed37a1b85dc1c76a6c45b829dd17:

Open 10.0 development tree (2024-12-10 17:41:17 +0000)

are available in the Git repository at:

https://git.linaro.org/people/pmaydell/qemu-arm.git tags/pull-target-arm-20241211

for you to fetch changes up to 1abe28d519239eea5cf9620bb13149423e5665f8:

MAINTAINERS: Add correct email address for Vikram Garhwal (2024-12-11 15:31:09 +0000)

----------------------------------------------------------------
target-arm queue:
 * hw/net/lan9118: Extract PHY model, reuse with imx_fec, fix bugs
 * fpu: Make muladd NaN handling runtime-selected, not compile-time
 * fpu: Make default NaN pattern runtime-selected, not compile-time
 * fpu: Minor NaN-related cleanups
 * MAINTAINERS: email address updates

----------------------------------------------------------------
Bernhard Beschow (5):
      hw/net/lan9118: Extract lan9118_phy
      hw/net/lan9118_phy: Reuse in imx_fec and consolidate implementations
      hw/net/lan9118_phy: Fix off-by-one error in MII_ANLPAR register
      hw/net/lan9118_phy: Reuse MII constants
      hw/net/lan9118_phy: Add missing 100 mbps full duplex advertisement

Leif Lindholm (1):
      MAINTAINERS: update email address for Leif Lindholm

Peter Maydell (54):
      fpu: handle raising Invalid for infzero in pick_nan_muladd
      fpu: Check for default_nan_mode before calling pickNaNMulAdd
      softfloat: Allow runtime choice of inf * 0 + NaN result
      tests/fp: Explicitly set inf-zero-nan rule
      target/arm: Set FloatInfZeroNaNRule explicitly
      target/s390: Set FloatInfZeroNaNRule explicitly
      target/ppc: Set FloatInfZeroNaNRule explicitly
      target/mips: Set FloatInfZeroNaNRule explicitly
      target/sparc: Set FloatInfZeroNaNRule explicitly
      target/xtensa: Set FloatInfZeroNaNRule explicitly
      target/x86: Set FloatInfZeroNaNRule explicitly
      target/loongarch: Set FloatInfZeroNaNRule explicitly
      target/hppa: Set FloatInfZeroNaNRule explicitly
      softfloat: Pass have_snan to pickNaNMulAdd
      softfloat: Allow runtime choice of NaN propagation for muladd
      tests/fp: Explicitly set 3-NaN propagation rule
      target/arm: Set Float3NaNPropRule explicitly
      target/loongarch: Set Float3NaNPropRule explicitly
      target/ppc: Set Float3NaNPropRule explicitly
      target/s390x: Set Float3NaNPropRule explicitly
      target/sparc: Set Float3NaNPropRule explicitly
      target/mips: Set Float3NaNPropRule explicitly
      target/xtensa: Set Float3NaNPropRule explicitly
      target/i386: Set Float3NaNPropRule explicitly
      target/hppa: Set Float3NaNPropRule explicitly
      fpu: Remove use_first_nan field from float_status
      target/m68k: Don't pass NULL float_status to floatx80_default_nan()
      softfloat: Create floatx80 default NaN from parts64_default_nan
      target/loongarch: Use normal float_status in fclass_s and fclass_d helpers
      target/m68k: In frem helper, initialize local float_status from env->fp_status
      target/m68k: Init local float_status from env fp_status in gdb get/set reg
      target/sparc: Initialize local scratch float_status from env->fp_status
      target/ppc: Use env->fp_status in helper_compute_fprf functions
      fpu: Allow runtime choice of default NaN value
      tests/fp: Set default NaN pattern explicitly
      target/microblaze: Set default NaN pattern explicitly
      target/i386: Set default NaN pattern explicitly
      target/hppa: Set default NaN pattern explicitly
      target/alpha: Set default NaN pattern explicitly
      target/arm: Set default NaN pattern explicitly
      target/loongarch: Set default NaN pattern explicitly
      target/m68k: Set default NaN pattern explicitly
      target/mips: Set default NaN pattern explicitly
      target/openrisc: Set default NaN pattern explicitly
      target/ppc: Set default NaN pattern explicitly
      target/sh4: Set default NaN pattern explicitly
      target/rx: Set default NaN pattern explicitly
      target/s390x: Set default NaN pattern explicitly
      target/sparc: Set default NaN pattern explicitly
      target/xtensa: Set default NaN pattern explicitly
      target/hexagon: Set default NaN pattern explicitly
      target/riscv: Set default NaN pattern explicitly
      target/tricore: Set default NaN pattern explicitly
      fpu: Remove default handling for dnan_pattern

Richard Henderson (11):
      target/arm: Copy entire float_status in is_ebf
      softfloat: Inline pickNaNMulAdd
      softfloat: Use goto for default nan case in pick_nan_muladd
      softfloat: Remove which from parts_pick_nan_muladd
      softfloat: Pad array size in pick_nan_muladd
      softfloat: Move propagateFloatx80NaN to softfloat.c
      softfloat: Use parts_pick_nan in propagateFloatx80NaN
      softfloat: Inline pickNaN
      softfloat: Share code between parts_pick_nan cases
      softfloat: Sink frac_cmp in parts_pick_nan until needed
      softfloat: Replace WHICH with RET in parts_pick_nan

Vikram Garhwal (1):
      MAINTAINERS: Add correct email address for Vikram Garhwal

From: Bernhard Beschow <shentey@gmail.com>

A very similar implementation of the same device exists in imx_fec. Prepare for
a common implementation by extracting a device model into its own files.

Some migration state has been moved into the new device model which breaks
migration compatibility for the following machines:
* smdkc210
* realview-*
* vexpress-*
* kzm
* mps2-*

While breaking migration ABI, fix the size of the MII registers to be 16 bit,
as defined by IEEE 802.3u.

Signed-off-by: Bernhard Beschow <shentey@gmail.com>
Tested-by: Guenter Roeck <linux@roeck-us.net>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20241102125724.532843-2-shentey@gmail.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/net/lan9118_phy.h |  37 ++++++++
 hw/net/lan9118.c             | 137 +++++-----------------------
 hw/net/lan9118_phy.c         | 169 +++++++++++++++++++++++++++++++++++
 hw/net/Kconfig               |   4 +
 hw/net/meson.build           |   1 +
 5 files changed, 233 insertions(+), 115 deletions(-)
 create mode 100644 include/hw/net/lan9118_phy.h
 create mode 100644 hw/net/lan9118_phy.c

diff --git a/include/hw/net/lan9118_phy.h b/include/hw/net/lan9118_phy.h
new file mode 100644
index XXXXXXX..XXXXXXX
--- /dev/null
+++ b/include/hw/net/lan9118_phy.h
@@ -XXX,XX +XXX,XX @@
+/*
+ * SMSC LAN9118 PHY emulation
+ *
+ * Copyright (c) 2009 CodeSourcery, LLC.
+ * Written by Paul Brook
+ *
+ * This work is licensed under the terms of the GNU GPL, version 2 or later.
+ * See the COPYING file in the top-level directory.
+ */
+
+#ifndef HW_NET_LAN9118_PHY_H
+#define HW_NET_LAN9118_PHY_H
+
+#include "qom/object.h"
+#include "hw/sysbus.h"
+
+#define TYPE_LAN9118_PHY "lan9118-phy"
+OBJECT_DECLARE_SIMPLE_TYPE(Lan9118PhyState, LAN9118_PHY)
+
+typedef struct Lan9118PhyState {
+    SysBusDevice parent_obj;
+
+    uint16_t status;
+    uint16_t control;
+    uint16_t advertise;
+    uint16_t ints;
+    uint16_t int_mask;
+    qemu_irq irq;
+    bool link_down;
+} Lan9118PhyState;
+
+void lan9118_phy_update_link(Lan9118PhyState *s, bool link_down);
+void lan9118_phy_reset(Lan9118PhyState *s);
+uint16_t lan9118_phy_read(Lan9118PhyState *s, int reg);
+void lan9118_phy_write(Lan9118PhyState *s, int reg, uint16_t val);
+
+#endif
diff --git a/hw/net/lan9118.c b/hw/net/lan9118.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/net/lan9118.c
+++ b/hw/net/lan9118.c
@@ -XXX,XX +XXX,XX @@
 #include "net/net.h"
 #include "net/eth.h"
 #include "hw/irq.h"
+#include "hw/net/lan9118_phy.h"
 #include "hw/net/lan9118.h"
 #include "hw/ptimer.h"
 #include "hw/qdev-properties.h"
@@ -XXX,XX +XXX,XX @@ do { printf("lan9118: " fmt , ## __VA_ARGS__); } while (0)
 #define MAC_CR_RXEN     0x00000004
 #define MAC_CR_RESERVED 0x7f404213
 
-#define PHY_INT_ENERGYON            0x80
-#define PHY_INT_AUTONEG_COMPLETE    0x40
-#define PHY_INT_FAULT               0x20
-#define PHY_INT_DOWN                0x10
-#define PHY_INT_AUTONEG_LP          0x08
-#define PHY_INT_PARFAULT            0x04
-#define PHY_INT_AUTONEG_PAGE        0x02
-
 #define GPT_TIMER_EN    0x20000000
 
 /*
@@ -XXX,XX +XXX,XX @@ struct lan9118_state {
     uint32_t mac_mii_data;
     uint32_t mac_flow;
 
-    uint32_t phy_status;
-    uint32_t phy_control;
-    uint32_t phy_advertise;
-    uint32_t phy_int;
-    uint32_t phy_int_mask;
+    Lan9118PhyState mii;
+    IRQState mii_irq;
 
     int32_t eeprom_writable;
     uint8_t eeprom[128];
@@ -XXX,XX +XXX,XX @@ struct lan9118_state {
 
 static const VMStateDescription vmstate_lan9118 = {
     .name = "lan9118",
-    .version_id = 2,
-    .minimum_version_id = 1,
+    .version_id = 3,
+    .minimum_version_id = 3,
     .fields = (const VMStateField[]) {
         VMSTATE_PTIMER(timer, lan9118_state),
         VMSTATE_UINT32(irq_cfg, lan9118_state),
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_lan9118 = {
         VMSTATE_UINT32(mac_mii_acc, lan9118_state),
         VMSTATE_UINT32(mac_mii_data, lan9118_state),
         VMSTATE_UINT32(mac_flow, lan9118_state),
-        VMSTATE_UINT32(phy_status, lan9118_state),
-        VMSTATE_UINT32(phy_control, lan9118_state),
-        VMSTATE_UINT32(phy_advertise, lan9118_state),
-        VMSTATE_UINT32(phy_int, lan9118_state),
-        VMSTATE_UINT32(phy_int_mask, lan9118_state),
         VMSTATE_INT32(eeprom_writable, lan9118_state),
         VMSTATE_UINT8_ARRAY(eeprom, lan9118_state, 128),
         VMSTATE_INT32(tx_fifo_size, lan9118_state),
@@ -XXX,XX +XXX,XX @@ static void lan9118_reload_eeprom(lan9118_state *s)
     lan9118_mac_changed(s);
 }
 
-static void phy_update_irq(lan9118_state *s)
+static void lan9118_update_irq(void *opaque, int n, int level)
 {
-    if (s->phy_int & s->phy_int_mask) {
+    lan9118_state *s = opaque;
+
+    if (level) {
         s->int_sts |= PHY_INT;
     } else {
         s->int_sts &= ~PHY_INT;
@@ -XXX,XX +XXX,XX @@ static void phy_update_irq(lan9118_state *s)
     lan9118_update(s);
 }
 
-static void phy_update_link(lan9118_state *s)
-{
-    /* Autonegotiation status mirrors link status.  */
-    if (qemu_get_queue(s->nic)->link_down) {
-        s->phy_status &= ~0x0024;
-        s->phy_int |= PHY_INT_DOWN;
-    } else {
-        s->phy_status |= 0x0024;
-        s->phy_int |= PHY_INT_ENERGYON;
-        s->phy_int |= PHY_INT_AUTONEG_COMPLETE;
-    }
-    phy_update_irq(s);
-}
-
 static void lan9118_set_link(NetClientState *nc)
 {
-    phy_update_link(qemu_get_nic_opaque(nc));
-}
-
-static void phy_reset(lan9118_state *s)
-{
-    s->phy_status = 0x7809;
-    s->phy_control = 0x3000;
-    s->phy_advertise = 0x01e1;
-    s->phy_int_mask = 0;
-    s->phy_int = 0;
-    phy_update_link(s);
+    lan9118_phy_update_link(&LAN9118(qemu_get_nic_opaque(nc))->mii,
+                            nc->link_down);
 }
 
 static void lan9118_reset(DeviceState *d)
@@ -XXX,XX +XXX,XX @@ static void lan9118_reset(DeviceState *d)
     s->read_word_n = 0;
     s->write_word_n = 0;
 
-    phy_reset(s);
-
     s->eeprom_writable = 0;
     lan9118_reload_eeprom(s);
 }
@@ -XXX,XX +XXX,XX @@ static void do_tx_packet(lan9118_state *s)
     uint32_t status;
 
     /* FIXME: Honor TX disable, and allow queueing of packets.  */
-    if (s->phy_control & 0x4000)  {
+    if (s->mii.control & 0x4000) {
         /* This assumes the receive routine doesn't touch the VLANClient.  */
         qemu_receive_packet(qemu_get_queue(s->nic), s->txp->data, s->txp->len);
     } else {
@@ -XXX,XX +XXX,XX @@ static void tx_fifo_push(lan9118_state *s, uint32_t val)
     }
 }
 
-static uint32_t do_phy_read(lan9118_state *s, int reg)
-{
-    uint32_t val;
-
-    switch (reg) {
-    case 0: /* Basic Control */
-        return s->phy_control;
-    case 1: /* Basic Status */
-        return s->phy_status;
-    case 2: /* ID1 */
-        return 0x0007;
-    case 3: /* ID2 */
-        return 0xc0d1;
-    case 4: /* Auto-neg advertisement */
-        return s->phy_advertise;
-    case 5: /* Auto-neg Link Partner Ability */
-        return 0x0f71;
-    case 6: /* Auto-neg Expansion */
-        return 1;
-        /* TODO 17, 18, 27, 29, 30, 31 */
-    case 29: /* Interrupt source.  */
-        val = s->phy_int;
-        s->phy_int = 0;
-        phy_update_irq(s);
-        return val;
-    case 30: /* Interrupt mask */
-        return s->phy_int_mask;
-    default:
-        qemu_log_mask(LOG_GUEST_ERROR,
-                      "do_phy_read: PHY read reg %d\n", reg);
-        return 0;
-    }
-}
-
-static void do_phy_write(lan9118_state *s, int reg, uint32_t val)
-{
-    switch (reg) {
-    case 0: /* Basic Control */
-        if (val & 0x8000) {
-            phy_reset(s);
-            break;
-        }
-        s->phy_control = val & 0x7980;
-        /* Complete autonegotiation immediately.  */
-        if (val & 0x1000) {
-            s->phy_status |= 0x0020;
-        }
-        break;
-    case 4: /* Auto-neg advertisement */
-        s->phy_advertise = (val & 0x2d7f) | 0x80;
-        break;
-        /* TODO 17, 18, 27, 31 */
-    case 30: /* Interrupt mask */
-        s->phy_int_mask = val & 0xff;
-        phy_update_irq(s);
-        break;
-    default:
-        qemu_log_mask(LOG_GUEST_ERROR,
-                      "do_phy_write: PHY write reg %d = 0x%04x\n", reg, val);
-    }
-}
-
 static void do_mac_write(lan9118_state *s, int reg, uint32_t val)
 {
     switch (reg) {
@@ -XXX,XX +XXX,XX @@ static void do_mac_write(lan9118_state *s, int reg, uint32_t val)
         if (val & 2) {
             DPRINTF("PHY write %d = 0x%04x\n",
                     (val >> 6) & 0x1f, s->mac_mii_data);
-            do_phy_write(s, (val >> 6) & 0x1f, s->mac_mii_data);
+            lan9118_phy_write(&s->mii, (val >> 6) & 0x1f, s->mac_mii_data);
         } else {
-            s->mac_mii_data = do_phy_read(s, (val >> 6) & 0x1f);
+            s->mac_mii_data = lan9118_phy_read(&s->mii, (val >> 6) & 0x1f);
             DPRINTF("PHY read %d = 0x%04x\n",
                     (val >> 6) & 0x1f, s->mac_mii_data);
         }
@@ -XXX,XX +XXX,XX @@ static void lan9118_writel(void *opaque, hwaddr offset,
         break;
     case CSR_PMT_CTRL:
         if (val & 0x400) {
-            phy_reset(s);
+            lan9118_phy_reset(&s->mii);
         }
         s->pmt_ctrl &= ~0x34e;
         s->pmt_ctrl |= (val & 0x34e);
@@ -XXX,XX +XXX,XX @@ static void lan9118_realize(DeviceState *dev, Error **errp)
     const MemoryRegionOps *mem_ops =
             s->mode_16bit ? &lan9118_16bit_mem_ops : &lan9118_mem_ops;
 
+    qemu_init_irq(&s->mii_irq, lan9118_update_irq, s, 0);
+    object_initialize_child(OBJECT(s), "mii", &s->mii, TYPE_LAN9118_PHY);
+    if (!sysbus_realize_and_unref(SYS_BUS_DEVICE(&s->mii), errp)) {
+        return;
+    }
+    qdev_connect_gpio_out(DEVICE(&s->mii), 0, &s->mii_irq);
+
     memory_region_init_io(&s->mmio, OBJECT(dev), mem_ops, s,
                           "lan9118-mmio", 0x100);
     sysbus_init_mmio(sbd, &s->mmio);
diff --git a/hw/net/lan9118_phy.c b/hw/net/lan9118_phy.c
new file mode 100644
index XXXXXXX..XXXXXXX
--- /dev/null
+++ b/hw/net/lan9118_phy.c
@@ -XXX,XX +XXX,XX @@
+/*
+ * SMSC LAN9118 PHY emulation
+ *
+ * Copyright (c) 2009 CodeSourcery, LLC.
+ * Written by Paul Brook
+ *
+ * This code is licensed under the GNU GPL v2
+ *
+ * Contributions after 2012-01-13 are licensed under the terms of the
+ * GNU GPL, version 2 or (at your option) any later version.
+ */
+
+#include "qemu/osdep.h"
+#include "hw/net/lan9118_phy.h"
+#include "hw/irq.h"
+#include "hw/resettable.h"
+#include "migration/vmstate.h"
+#include "qemu/log.h"
+
+#define PHY_INT_ENERGYON            (1 << 7)
+#define PHY_INT_AUTONEG_COMPLETE    (1 << 6)
+#define PHY_INT_FAULT               (1 << 5)
+#define PHY_INT_DOWN                (1 << 4)
+#define PHY_INT_AUTONEG_LP          (1 << 3)
+#define PHY_INT_PARFAULT            (1 << 2)
+#define PHY_INT_AUTONEG_PAGE        (1 << 1)
+
+static void lan9118_phy_update_irq(Lan9118PhyState *s)
+{
+    qemu_set_irq(s->irq, !!(s->ints & s->int_mask));
+}
+
+uint16_t lan9118_phy_read(Lan9118PhyState *s, int reg)
+{
+    uint16_t val;
+
+    switch (reg) {
+    case 0: /* Basic Control */
+        return s->control;
+    case 1: /* Basic Status */
+        return s->status;
+    case 2: /* ID1 */
+        return 0x0007;
+    case 3: /* ID2 */
+        return 0xc0d1;
+    case 4: /* Auto-neg advertisement */
+        return s->advertise;
+    case 5: /* Auto-neg Link Partner Ability */
+        return 0x0f71;
+    case 6: /* Auto-neg Expansion */
+        return 1;
+        /* TODO 17, 18, 27, 29, 30, 31 */
+    case 29: /* Interrupt source. */
+        val = s->ints;
+        s->ints = 0;
+        lan9118_phy_update_irq(s);
+        return val;
+    case 30: /* Interrupt mask */
+        return s->int_mask;
+    default:
+        qemu_log_mask(LOG_GUEST_ERROR,
+                      "lan9118_phy_read: PHY read reg %d\n", reg);
+        return 0;
+    }
+}
+
+void lan9118_phy_write(Lan9118PhyState *s, int reg, uint16_t val)
+{
+    switch (reg) {
+    case 0: /* Basic Control */
+        if (val & 0x8000) {
+            lan9118_phy_reset(s);
+            break;
+        }
+        s->control = val & 0x7980;
+        /* Complete autonegotiation immediately. */
+        if (val & 0x1000) {
+            s->status |= 0x0020;
+        }
+        break;
+    case 4: /* Auto-neg advertisement */
+        s->advertise = (val & 0x2d7f) | 0x80;
+        break;
+        /* TODO 17, 18, 27, 31 */
+    case 30: /* Interrupt mask */
+        s->int_mask = val & 0xff;
+        lan9118_phy_update_irq(s);
+        break;
+    default:
+        qemu_log_mask(LOG_GUEST_ERROR,
+                      "lan9118_phy_write: PHY write reg %d = 0x%04x\n", reg, val);
+    }
+}
+
+void lan9118_phy_update_link(Lan9118PhyState *s, bool link_down)
+{
+    s->link_down = link_down;
+
+    /* Autonegotiation status mirrors link status. */
+    if (link_down) {
+        s->status &= ~0x0024;
+        s->ints |= PHY_INT_DOWN;
+    } else {
+        s->status |= 0x0024;
+        s->ints |= PHY_INT_ENERGYON;
+        s->ints |= PHY_INT_AUTONEG_COMPLETE;
+    }
+    lan9118_phy_update_irq(s);
+}
+
+void lan9118_phy_reset(Lan9118PhyState *s)
+{
+    s->control = 0x3000;
+    s->status = 0x7809;
+    s->advertise = 0x01e1;
+    s->int_mask = 0;
+    s->ints = 0;
+    lan9118_phy_update_link(s, s->link_down);
+}
+
+static void lan9118_phy_reset_hold(Object *obj, ResetType type)
+{
+    Lan9118PhyState *s = LAN9118_PHY(obj);
+
+    lan9118_phy_reset(s);
+}
+
+static void lan9118_phy_init(Object *obj)
+{
+    Lan9118PhyState *s = LAN9118_PHY(obj);
+
+    qdev_init_gpio_out(DEVICE(s), &s->irq, 1);
+}
+
+static const VMStateDescription vmstate_lan9118_phy = {
+    .name = "lan9118-phy",
+    .version_id = 1,
+    .minimum_version_id = 1,
+    .fields = (const VMStateField[]) {
+        VMSTATE_UINT16(control, Lan9118PhyState),
+        VMSTATE_UINT16(status, Lan9118PhyState),
+        VMSTATE_UINT16(advertise, Lan9118PhyState),
+        VMSTATE_UINT16(ints, Lan9118PhyState),
+        VMSTATE_UINT16(int_mask, Lan9118PhyState),
+        VMSTATE_BOOL(link_down, Lan9118PhyState),
+        VMSTATE_END_OF_LIST()
+    }
+};
+
+static void lan9118_phy_class_init(ObjectClass *klass, void *data)
+{
+    ResettableClass *rc = RESETTABLE_CLASS(klass);
+    DeviceClass *dc = DEVICE_CLASS(klass);
+
+    rc->phases.hold = lan9118_phy_reset_hold;
+    dc->vmsd = &vmstate_lan9118_phy;
+}
+
+static const TypeInfo types[] = {
+    {
+        .name          = TYPE_LAN9118_PHY,
+        .parent        = TYPE_SYS_BUS_DEVICE,
+        .instance_size = sizeof(Lan9118PhyState),
+        .instance_init = lan9118_phy_init,
+        .class_init    = lan9118_phy_class_init,
+    }
+};
+
+DEFINE_TYPES(types)
diff --git a/hw/net/Kconfig b/hw/net/Kconfig
index XXXXXXX..XXXXXXX 100644
--- a/hw/net/Kconfig
+++ b/hw/net/Kconfig
@@ -XXX,XX +XXX,XX @@ config VMXNET3_PCI
 config SMC91C111
     bool
 
+config LAN9118_PHY
+    bool
+
 config LAN9118
     bool
+    select LAN9118_PHY
     select PTIMER
 
 config NE2000_ISA
diff --git a/hw/net/meson.build b/hw/net/meson.build
index XXXXXXX..XXXXXXX 100644
--- a/hw/net/meson.build
+++ b/hw/net/meson.build
@@ -XXX,XX +XXX,XX @@ system_ss.add(when: 'CONFIG_VMXNET3_PCI', if_true: files('vmxnet3.c'))
 
 system_ss.add(when: 'CONFIG_SMC91C111', if_true: files('smc91c111.c'))
 system_ss.add(when: 'CONFIG_LAN9118', if_true: files('lan9118.c'))
+system_ss.add(when: 'CONFIG_LAN9118_PHY', if_true: files('lan9118_phy.c'))
 system_ss.add(when: 'CONFIG_NE2000_ISA', if_true: files('ne2000-isa.c'))
 system_ss.add(when: 'CONFIG_OPENCORES_ETH', if_true: files('opencores_eth.c'))
 system_ss.add(when: 'CONFIG_XGMAC', if_true: files('xgmac.c'))
-- 
2.34.1

From: Bernhard Beschow <shentey@gmail.com>

imx_fec models the same PHY as lan9118_phy. The code is almost the same with
imx_fec having more logging and tracing. Merge these improvements into
lan9118_phy and reuse in imx_fec to fix the code duplication.

Some migration state how resides in the new device model which breaks migration
compatibility for the following machines:
* imx25-pdk
* sabrelite
* mcimx7d-sabre
* mcimx6ul-evk

Signed-off-by: Bernhard Beschow <shentey@gmail.com>
Tested-by: Guenter Roeck <linux@roeck-us.net>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20241102125724.532843-3-shentey@gmail.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/net/imx_fec.h |   9 ++-
 hw/net/imx_fec.c         | 146 ++++-----------------------------------
 hw/net/lan9118_phy.c     |  82 ++++++++++++++++------
 hw/net/Kconfig           |   1 +
 hw/net/trace-events      |  10 +--
 5 files changed, 85 insertions(+), 163 deletions(-)

diff --git a/include/hw/net/imx_fec.h b/include/hw/net/imx_fec.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/net/imx_fec.h
+++ b/include/hw/net/imx_fec.h
@@ -XXX,XX +XXX,XX @@ OBJECT_DECLARE_SIMPLE_TYPE(IMXFECState, IMX_FEC)
 #define TYPE_IMX_ENET "imx.enet"
 
 #include "hw/sysbus.h"
+#include "hw/net/lan9118_phy.h"
+#include "hw/irq.h"
 #include "net/net.h"
 
 #define ENET_EIR               1
@@ -XXX,XX +XXX,XX @@ struct IMXFECState {
     uint32_t tx_descriptor[ENET_TX_RING_NUM];
     uint32_t tx_ring_num;
 
-    uint32_t phy_status;
-    uint32_t phy_control;
-    uint32_t phy_advertise;
-    uint32_t phy_int;
-    uint32_t phy_int_mask;
+    Lan9118PhyState mii;
+    IRQState mii_irq;
     uint32_t phy_num;
     bool phy_connected;
     struct IMXFECState *phy_consumer;
diff --git a/hw/net/imx_fec.c b/hw/net/imx_fec.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/net/imx_fec.c
+++ b/hw/net/imx_fec.c
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_imx_eth_txdescs = {
 
 static const VMStateDescription vmstate_imx_eth = {
     .name = TYPE_IMX_FEC,
-    .version_id = 2,
-    .minimum_version_id = 2,
+    .version_id = 3,
+    .minimum_version_id = 3,
     .fields = (const VMStateField[]) {
         VMSTATE_UINT32_ARRAY(regs, IMXFECState, ENET_MAX),
         VMSTATE_UINT32(rx_descriptor, IMXFECState),
         VMSTATE_UINT32(tx_descriptor[0], IMXFECState),
-        VMSTATE_UINT32(phy_status, IMXFECState),
-        VMSTATE_UINT32(phy_control, IMXFECState),
-        VMSTATE_UINT32(phy_advertise, IMXFECState),
-        VMSTATE_UINT32(phy_int, IMXFECState),
-        VMSTATE_UINT32(phy_int_mask, IMXFECState),
         VMSTATE_END_OF_LIST()
     },
     .subsections = (const VMStateDescription * const []) {
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_imx_eth = {
     },
 };
 
-#define PHY_INT_ENERGYON            (1 << 7)
-#define PHY_INT_AUTONEG_COMPLETE    (1 << 6)
-#define PHY_INT_FAULT               (1 << 5)
-#define PHY_INT_DOWN                (1 << 4)
-#define PHY_INT_AUTONEG_LP          (1 << 3)
-#define PHY_INT_PARFAULT            (1 << 2)
-#define PHY_INT_AUTONEG_PAGE        (1 << 1)
-
 static void imx_eth_update(IMXFECState *s);
 
 /*
@@ -XXX,XX +XXX,XX @@ static void imx_eth_update(IMXFECState *s);
  * For now we don't handle any GPIO/interrupt line, so the OS will
  * have to poll for the PHY status.
  */
-static void imx_phy_update_irq(IMXFECState *s)
+static void imx_phy_update_irq(void *opaque, int n, int level)
 {
-    imx_eth_update(s);
-}
-
-static void imx_phy_update_link(IMXFECState *s)
-{
-    /* Autonegotiation status mirrors link status.  */
-    if (qemu_get_queue(s->nic)->link_down) {
-        trace_imx_phy_update_link("down");
-        s->phy_status &= ~0x0024;
-        s->phy_int |= PHY_INT_DOWN;
-    } else {
-        trace_imx_phy_update_link("up");
-        s->phy_status |= 0x0024;
-        s->phy_int |= PHY_INT_ENERGYON;
-        s->phy_int |= PHY_INT_AUTONEG_COMPLETE;
-    }
-    imx_phy_update_irq(s);
+    imx_eth_update(opaque);
 }
 
 static void imx_eth_set_link(NetClientState *nc)
 {
-    imx_phy_update_link(IMX_FEC(qemu_get_nic_opaque(nc)));
-}
-
-static void imx_phy_reset(IMXFECState *s)
-{
-    trace_imx_phy_reset();
-
-    s->phy_status = 0x7809;
-    s->phy_control = 0x3000;
-    s->phy_advertise = 0x01e1;
-    s->phy_int_mask = 0;
-    s->phy_int = 0;
-    imx_phy_update_link(s);
+    lan9118_phy_update_link(&IMX_FEC(qemu_get_nic_opaque(nc))->mii,
+                            nc->link_down);
 }
 
 static uint32_t imx_phy_read(IMXFECState *s, int reg)
 {
-    uint32_t val;
     uint32_t phy = reg / 32;
 
     if (!s->phy_connected) {
@@ -XXX,XX +XXX,XX @@ static uint32_t imx_phy_read(IMXFECState *s, int reg)
 
     reg %= 32;
 
-    switch (reg) {
-    case 0:     /* Basic Control */
-        val = s->phy_control;
-        break;
-    case 1:     /* Basic Status */
-        val = s->phy_status;
-        break;
-    case 2:     /* ID1 */
-        val = 0x0007;
-        break;
-    case 3:     /* ID2 */
-        val = 0xc0d1;
-        break;
-    case 4:     /* Auto-neg advertisement */
-        val = s->phy_advertise;
-        break;
-    case 5:     /* Auto-neg Link Partner Ability */
-        val = 0x0f71;
-        break;
-    case 6:     /* Auto-neg Expansion */
-        val = 1;
-        break;
-    case 29:    /* Interrupt source.  */
-        val = s->phy_int;
-        s->phy_int = 0;
-        imx_phy_update_irq(s);
-        break;
-    case 30:    /* Interrupt mask */
-        val = s->phy_int_mask;
-        break;
-    case 17:
-    case 18:
-    case 27:
-    case 31:
-        qemu_log_mask(LOG_UNIMP, "[%s.phy]%s: reg %d not implemented\n",
-                      TYPE_IMX_FEC, __func__, reg);
-        val = 0;
-        break;
-    default:
-        qemu_log_mask(LOG_GUEST_ERROR, "[%s.phy]%s: Bad address at offset %d\n",
-                      TYPE_IMX_FEC, __func__, reg);
-        val = 0;
-        break;
-    }
-
-    trace_imx_phy_read(val, phy, reg);
-
-    return val;
+    return lan9118_phy_read(&s->mii, reg);
 }
 
 static void imx_phy_write(IMXFECState *s, int reg, uint32_t val)
@@ -XXX,XX +XXX,XX @@ static void imx_phy_write(IMXFECState *s, int reg, uint32_t val)
 
     reg %= 32;
 
-    trace_imx_phy_write(val, phy, reg);
-
-    switch (reg) {
-    case 0:     /* Basic Control */
-        if (val & 0x8000) {
-            imx_phy_reset(s);
-        } else {
-            s->phy_control = val & 0x7980;
-            /* Complete autonegotiation immediately.  */
-            if (val & 0x1000) {
-                s->phy_status |= 0x0020;
-            }
-        }
-        break;
-    case 4:     /* Auto-neg advertisement */
-        s->phy_advertise = (val & 0x2d7f) | 0x80;
-        break;
-    case 30:    /* Interrupt mask */
-        s->phy_int_mask = val & 0xff;
-        imx_phy_update_irq(s);
-        break;
-    case 17:
-    case 18:
-    case 27:
-    case 31:
-        qemu_log_mask(LOG_UNIMP, "[%s.phy)%s: reg %d not implemented\n",
-                      TYPE_IMX_FEC, __func__, reg);
-        break;
-    default:
-        qemu_log_mask(LOG_GUEST_ERROR, "[%s.phy]%s: Bad address at offset %d\n",
-                      TYPE_IMX_FEC, __func__, reg);
-        break;
-    }
+    lan9118_phy_write(&s->mii, reg, val);
 }
 
 static void imx_fec_read_bd(IMXFECBufDesc *bd, dma_addr_t addr)
@@ -XXX,XX +XXX,XX @@ static void imx_eth_reset(DeviceState *d)
 
     s->rx_descriptor = 0;
     memset(s->tx_descriptor, 0, sizeof(s->tx_descriptor));
-
-    /* We also reset the PHY */
-    imx_phy_reset(s);
 }
 
 static uint32_t imx_default_read(IMXFECState *s, uint32_t index)
@@ -XXX,XX +XXX,XX @@ static void imx_eth_realize(DeviceState *dev, Error **errp)
     sysbus_init_irq(sbd, &s->irq[0]);
     sysbus_init_irq(sbd, &s->irq[1]);
 
+    qemu_init_irq(&s->mii_irq, imx_phy_update_irq, s, 0);
+    object_initialize_child(OBJECT(s), "mii", &s->mii, TYPE_LAN9118_PHY);
+    if (!sysbus_realize_and_unref(SYS_BUS_DEVICE(&s->mii), errp)) {
+        return;
+    }
+    qdev_connect_gpio_out(DEVICE(&s->mii), 0, &s->mii_irq);
+
     qemu_macaddr_default_if_unset(&s->conf.macaddr);
 
     s->nic = qemu_new_nic(&imx_eth_net_info, &s->conf,
diff --git a/hw/net/lan9118_phy.c b/hw/net/lan9118_phy.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/net/lan9118_phy.c
+++ b/hw/net/lan9118_phy.c
@@ -XXX,XX +XXX,XX @@
  * Copyright (c) 2009 CodeSourcery, LLC.
  * Written by Paul Brook
  *
+ * Copyright (c) 2013 Jean-Christophe Dubois. <jcd@tribudubois.net>
+ *
  * This code is licensed under the GNU GPL v2
  *
  * Contributions after 2012-01-13 are licensed under the terms of the
@@ -XXX,XX +XXX,XX @@
 #include "hw/resettable.h"
 #include "migration/vmstate.h"
 #include "qemu/log.h"
+#include "trace.h"
 
 #define PHY_INT_ENERGYON            (1 << 7)
 #define PHY_INT_AUTONEG_COMPLETE    (1 << 6)
@@ -XXX,XX +XXX,XX @@ uint16_t lan9118_phy_read(Lan9118PhyState *s, int reg)
 
     switch (reg) {
     case 0: /* Basic Control */
-        return s->control;
+        val = s->control;
+        break;
     case 1: /* Basic Status */
-        return s->status;
+        val = s->status;
+        break;
     case 2: /* ID1 */
-        return 0x0007;
+        val = 0x0007;
+        break;
     case 3: /* ID2 */
-        return 0xc0d1;
+        val = 0xc0d1;
+        break;
     case 4: /* Auto-neg advertisement */
-        return s->advertise;
+        val = s->advertise;
+        break;
     case 5: /* Auto-neg Link Partner Ability */
-        return 0x0f71;
+        val = 0x0f71;
+        break;
     case 6: /* Auto-neg Expansion */
-        return 1;
-        /* TODO 17, 18, 27, 29, 30, 31 */
+        val = 1;
+        break;
     case 29: /* Interrupt source. */
         val = s->ints;
         s->ints = 0;
         lan9118_phy_update_irq(s);
-        return val;
+        break;
     case 30: /* Interrupt mask */
-        return s->int_mask;
+        val = s->int_mask;
+        break;
+    case 17:
+    case 18:
+    case 27:
+    case 31:
+        qemu_log_mask(LOG_UNIMP, "%s: reg %d not implemented\n",
+                      __func__, reg);
+        val = 0;
+        break;
     default:
-        qemu_log_mask(LOG_GUEST_ERROR,
-                      "lan9118_phy_read: PHY read reg %d\n", reg);
-        return 0;
+        qemu_log_mask(LOG_GUEST_ERROR, "%s: Bad address at offset %d\n",
+                      __func__, reg);
+        val = 0;
+        break;
     }
+
+    trace_lan9118_phy_read(val, reg);
+
+    return val;
 }
 
 void lan9118_phy_write(Lan9118PhyState *s, int reg, uint16_t val)
 {
+    trace_lan9118_phy_write(val, reg);
+
     switch (reg) {
     case 0: /* Basic Control */
         if (val & 0x8000) {
             lan9118_phy_reset(s);
-            break;
-        }
-        s->control = val & 0x7980;
-        /* Complete autonegotiation immediately. */
-        if (val & 0x1000) {
-            s->status |= 0x0020;
+        } else {
+            s->control = val & 0x7980;
+            /* Complete autonegotiation immediately. */
+            if (val & 0x1000) {
+                s->status |= 0x0020;
+            }
         }
         break;
     case 4: /* Auto-neg advertisement */
         s->advertise = (val & 0x2d7f) | 0x80;
         break;
-        /* TODO 17, 18, 27, 31 */
     case 30: /* Interrupt mask */
         s->int_mask = val & 0xff;
         lan9118_phy_update_irq(s);
         break;
+    case 17:
+    case 18:
+    case 27:
+    case 31:
+        qemu_log_mask(LOG_UNIMP, "%s: reg %d not implemented\n",
+                      __func__, reg);
+        break;
     default:
-        qemu_log_mask(LOG_GUEST_ERROR,
-                      "lan9118_phy_write: PHY write reg %d = 0x%04x\n", reg, val);
+        qemu_log_mask(LOG_GUEST_ERROR, "%s: Bad address at offset %d\n",
+                      __func__, reg);
+        break;
     }
 }
 
@@ -XXX,XX +XXX,XX @@ void lan9118_phy_update_link(Lan9118PhyState *s, bool link_down)
 
     /* Autonegotiation status mirrors link status. */
     if (link_down) {
+        trace_lan9118_phy_update_link("down");
         s->status &= ~0x0024;
         s->ints |= PHY_INT_DOWN;
     } else {
+        trace_lan9118_phy_update_link("up");
         s->status |= 0x0024;
         s->ints |= PHY_INT_ENERGYON;
         s->ints |= PHY_INT_AUTONEG_COMPLETE;
@@ -XXX,XX +XXX,XX @@ void lan9118_phy_update_link(Lan9118PhyState *s, bool link_down)
 
 void lan9118_phy_reset(Lan9118PhyState *s)
 {
+    trace_lan9118_phy_reset();
+
     s->control = 0x3000;
     s->status = 0x7809;
     s->advertise = 0x01e1;
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_lan9118_phy = {
     .version_id = 1,
     .minimum_version_id = 1,
     .fields = (const VMStateField[]) {
-        VMSTATE_UINT16(control, Lan9118PhyState),
         VMSTATE_UINT16(status, Lan9118PhyState),
+        VMSTATE_UINT16(control, Lan9118PhyState),
         VMSTATE_UINT16(advertise, Lan9118PhyState),
         VMSTATE_UINT16(ints, Lan9118PhyState),
         VMSTATE_UINT16(int_mask, Lan9118PhyState),
diff --git a/hw/net/Kconfig b/hw/net/Kconfig
index XXXXXXX..XXXXXXX 100644
--- a/hw/net/Kconfig
+++ b/hw/net/Kconfig
@@ -XXX,XX +XXX,XX @@ config ALLWINNER_SUN8I_EMAC
 
 config IMX_FEC
     bool
+    select LAN9118_PHY
 
 config CADENCE
     bool
diff --git a/hw/net/trace-events b/hw/net/trace-events
index XXXXXXX..XXXXXXX 100644
--- a/hw/net/trace-events
+++ b/hw/net/trace-events
@@ -XXX,XX +XXX,XX @@ allwinner_sun8i_emac_set_link(bool active) "Set link: active=%u"
 allwinner_sun8i_emac_read(uint64_t offset, uint64_t val) "MMIO read: offset=0x%" PRIx64 " value=0x%" PRIx64
 allwinner_sun8i_emac_write(uint64_t offset, uint64_t val) "MMIO write: offset=0x%" PRIx64 " value=0x%" PRIx64
 
+# lan9118_phy.c
+lan9118_phy_read(uint16_t val, int reg) "[0x%02x] -> 0x%04" PRIx16
+lan9118_phy_write(uint16_t val, int reg) "[0x%02x] <- 0x%04" PRIx16
+lan9118_phy_update_link(const char *s) "%s"
+lan9118_phy_reset(void) ""
+
 # lance.c
 lance_mem_readw(uint64_t addr, uint32_t ret) "addr=0x%"PRIx64"val=0x%04x"
 lance_mem_writew(uint64_t addr, uint32_t val) "addr=0x%"PRIx64"val=0x%04x"
@@ -XXX,XX +XXX,XX @@ i82596_set_multicast(uint16_t count) "Added %d multicast entries"
 i82596_channel_attention(void *s) "%p: Received CHANNEL ATTENTION"
 
 # imx_fec.c
-imx_phy_read(uint32_t val, int phy, int reg) "0x%04"PRIx32" <= phy[%d].reg[%d]"
 imx_phy_read_num(int phy, int configured) "read request from unconfigured phy %d (configured %d)"
-imx_phy_write(uint32_t val, int phy, int reg) "0x%04"PRIx32" => phy[%d].reg[%d]"
 imx_phy_write_num(int phy, int configured) "write request to unconfigured phy %d (configured %d)"
-imx_phy_update_link(const char *s) "%s"
-imx_phy_reset(void) ""
 imx_fec_read_bd(uint64_t addr, int flags, int len, int data) "tx_bd 0x%"PRIx64" flags 0x%04x len %d data 0x%08x"
 imx_enet_read_bd(uint64_t addr, int flags, int len, int data, int options, int status) "tx_bd 0x%"PRIx64" flags 0x%04x len %d data 0x%08x option 0x%04x status 0x%04x"
 imx_eth_tx_bd_busy(void) "tx_bd ran out of descriptors to transmit"
-- 
2.34.1

From: Bernhard Beschow <shentey@gmail.com>

Turns 0x70 into 0xe0 (== 0x70 << 1) which adds the missing MII_ANLPAR_TX and
fixes the MSB of selector field to be zero, as specified in the datasheet.

Fixes: 2a424990170b "LAN9118 emulation"
Signed-off-by: Bernhard Beschow <shentey@gmail.com>
Tested-by: Guenter Roeck <linux@roeck-us.net>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20241102125724.532843-4-shentey@gmail.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/net/lan9118_phy.c | 2 +-
 1 file changed, 1 insertion(+), 1 deletion(-)

diff --git a/hw/net/lan9118_phy.c b/hw/net/lan9118_phy.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/net/lan9118_phy.c
+++ b/hw/net/lan9118_phy.c
@@ -XXX,XX +XXX,XX @@ uint16_t lan9118_phy_read(Lan9118PhyState *s, int reg)
         val = s->advertise;
         break;
     case 5: /* Auto-neg Link Partner Ability */
-        val = 0x0f71;
+        val = 0x0fe1;
         break;
     case 6: /* Auto-neg Expansion */
         val = 1;
-- 
2.34.1

From: Bernhard Beschow <shentey@gmail.com>

Prefer named constants over magic values for better readability.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Bernhard Beschow <shentey@gmail.com>
Tested-by: Guenter Roeck <linux@roeck-us.net>
Message-id: 20241102125724.532843-5-shentey@gmail.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/net/mii.h |  6 +++++
 hw/net/lan9118_phy.c | 63 ++++++++++++++++++++++++++++----------------
 2 files changed, 46 insertions(+), 23 deletions(-)

diff --git a/include/hw/net/mii.h b/include/hw/net/mii.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/net/mii.h
+++ b/include/hw/net/mii.h
@@ -XXX,XX +XXX,XX @@
 #define MII_BMSR_JABBER     (1 << 1)  /* Jabber detected */
 #define MII_BMSR_EXTCAP     (1 << 0)  /* Ext-reg capability */
 
+#define MII_ANAR_RFAULT     (1 << 13) /* Say we can detect faults */
 #define MII_ANAR_PAUSE_ASYM (1 << 11) /* Try for asymmetric pause */
 #define MII_ANAR_PAUSE      (1 << 10) /* Try for pause */
 #define MII_ANAR_TXFD       (1 << 8)
@@ -XXX,XX +XXX,XX @@
 #define MII_ANAR_10FD       (1 << 6)
 #define MII_ANAR_10         (1 << 5)
 #define MII_ANAR_CSMACD     (1 << 0)
+#define MII_ANAR_SELECT     (0x001f)  /* Selector bits */
 
 #define MII_ANLPAR_ACK      (1 << 14)
 #define MII_ANLPAR_PAUSEASY (1 << 11) /* can pause asymmetrically */
@@ -XXX,XX +XXX,XX @@
 #define RTL8201CP_PHYID1    0x0000
 #define RTL8201CP_PHYID2    0x8201
 
+/* SMSC LAN9118 */
+#define SMSCLAN9118_PHYID1  0x0007
+#define SMSCLAN9118_PHYID2  0xc0d1
+
 /* RealTek 8211E */
 #define RTL8211E_PHYID1     0x001c
 #define RTL8211E_PHYID2     0xc915
diff --git a/hw/net/lan9118_phy.c b/hw/net/lan9118_phy.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/net/lan9118_phy.c
+++ b/hw/net/lan9118_phy.c
@@ -XXX,XX +XXX,XX @@
 
 #include "qemu/osdep.h"
 #include "hw/net/lan9118_phy.h"
+#include "hw/net/mii.h"
 #include "hw/irq.h"
 #include "hw/resettable.h"
 #include "migration/vmstate.h"
@@ -XXX,XX +XXX,XX @@ uint16_t lan9118_phy_read(Lan9118PhyState *s, int reg)
     uint16_t val;
 
     switch (reg) {
-    case 0: /* Basic Control */
+    case MII_BMCR:
         val = s->control;
         break;
-    case 1: /* Basic Status */
+    case MII_BMSR:
         val = s->status;
         break;
-    case 2: /* ID1 */
-        val = 0x0007;
+    case MII_PHYID1:
+        val = SMSCLAN9118_PHYID1;
         break;
-    case 3: /* ID2 */
-        val = 0xc0d1;
+    case MII_PHYID2:
+        val = SMSCLAN9118_PHYID2;
         break;
-    case 4: /* Auto-neg advertisement */
+    case MII_ANAR:
         val = s->advertise;
         break;
-    case 5: /* Auto-neg Link Partner Ability */
-        val = 0x0fe1;
+    case MII_ANLPAR:
+        val = MII_ANLPAR_PAUSEASY | MII_ANLPAR_PAUSE | MII_ANLPAR_T4 |
+              MII_ANLPAR_TXFD | MII_ANLPAR_TX | MII_ANLPAR_10FD |
+              MII_ANLPAR_10 | MII_ANLPAR_CSMACD;
         break;
-    case 6: /* Auto-neg Expansion */
-        val = 1;
+    case MII_ANER:
+        val = MII_ANER_NWAY;
         break;
     case 29: /* Interrupt source. */
         val = s->ints;
@@ -XXX,XX +XXX,XX @@ void lan9118_phy_write(Lan9118PhyState *s, int reg, uint16_t val)
     trace_lan9118_phy_write(val, reg);
 
     switch (reg) {
-    case 0: /* Basic Control */
-        if (val & 0x8000) {
+    case MII_BMCR:
+        if (val & MII_BMCR_RESET) {
             lan9118_phy_reset(s);
         } else {
-            s->control = val & 0x7980;
+            s->control = val & (MII_BMCR_LOOPBACK | MII_BMCR_SPEED100 |
+                                MII_BMCR_AUTOEN | MII_BMCR_PDOWN | MII_BMCR_FD |
+                                MII_BMCR_CTST);
             /* Complete autonegotiation immediately. */
-            if (val & 0x1000) {
-                s->status |= 0x0020;
+            if (val & MII_BMCR_AUTOEN) {
+                s->status |= MII_BMSR_AN_COMP;
             }
         }
         break;
-    case 4: /* Auto-neg advertisement */
-        s->advertise = (val & 0x2d7f) | 0x80;
+    case MII_ANAR:
+        s->advertise = (val & (MII_ANAR_RFAULT | MII_ANAR_PAUSE_ASYM |
+                               MII_ANAR_PAUSE | MII_ANAR_10FD | MII_ANAR_10 |
+                               MII_ANAR_SELECT))
+                     | MII_ANAR_TX;
         break;
     case 30: /* Interrupt mask */
         s->int_mask = val & 0xff;
@@ -XXX,XX +XXX,XX @@ void lan9118_phy_update_link(Lan9118PhyState *s, bool link_down)
     /* Autonegotiation status mirrors link status. */
     if (link_down) {
         trace_lan9118_phy_update_link("down");
-        s->status &= ~0x0024;
+        s->status &= ~(MII_BMSR_AN_COMP | MII_BMSR_LINK_ST);
         s->ints |= PHY_INT_DOWN;
     } else {
         trace_lan9118_phy_update_link("up");
-        s->status |= 0x0024;
+        s->status |= MII_BMSR_AN_COMP | MII_BMSR_LINK_ST;
         s->ints |= PHY_INT_ENERGYON;
         s->ints |= PHY_INT_AUTONEG_COMPLETE;
     }
@@ -XXX,XX +XXX,XX @@ void lan9118_phy_reset(Lan9118PhyState *s)
 {
     trace_lan9118_phy_reset();
 
-    s->control = 0x3000;
-    s->status = 0x7809;
-    s->advertise = 0x01e1;
+    s->control = MII_BMCR_AUTOEN | MII_BMCR_SPEED100;
+    s->status = MII_BMSR_100TX_FD
+                | MII_BMSR_100TX_HD
+                | MII_BMSR_10T_FD
+                | MII_BMSR_10T_HD
+                | MII_BMSR_AUTONEG
+                | MII_BMSR_EXTCAP;
+    s->advertise = MII_ANAR_TXFD
+                   | MII_ANAR_TX
+                   | MII_ANAR_10FD
+                   | MII_ANAR_10
+                   | MII_ANAR_CSMACD;
     s->int_mask = 0;
     s->ints = 0;
     lan9118_phy_update_link(s, s->link_down);
-- 
2.34.1

From: Bernhard Beschow <shentey@gmail.com>

The real device advertises this mode and the device model already advertises
100 mbps half duplex and 10 mbps full+half duplex. So advertise this mode to
make the model more realistic.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Bernhard Beschow <shentey@gmail.com>
Tested-by: Guenter Roeck <linux@roeck-us.net>
Message-id: 20241102125724.532843-6-shentey@gmail.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/net/lan9118_phy.c | 4 ++--
 1 file changed, 2 insertions(+), 2 deletions(-)

diff --git a/hw/net/lan9118_phy.c b/hw/net/lan9118_phy.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/net/lan9118_phy.c
+++ b/hw/net/lan9118_phy.c
@@ -XXX,XX +XXX,XX @@ void lan9118_phy_write(Lan9118PhyState *s, int reg, uint16_t val)
         break;
     case MII_ANAR:
         s->advertise = (val & (MII_ANAR_RFAULT | MII_ANAR_PAUSE_ASYM |
-                               MII_ANAR_PAUSE | MII_ANAR_10FD | MII_ANAR_10 |
-                               MII_ANAR_SELECT))
+                               MII_ANAR_PAUSE | MII_ANAR_TXFD | MII_ANAR_10FD |
+                               MII_ANAR_10 | MII_ANAR_SELECT))
                      | MII_ANAR_TX;
         break;
     case 30: /* Interrupt mask */
-- 
2.34.1

For IEEE fused multiply-add, the (0 * inf) + NaN case should raise
Invalid for the multiplication of 0 by infinity.  Currently we handle
this in the per-architecture ifdef ladder in pickNaNMulAdd().
However, since this isn't really architecture specific we can hoist
it up to the generic code.

For the cases where the infzero test in pickNaNMulAdd was
returning 2, we can delete the check entirely and allow the
code to fall into the normal pick-a-NaN handling, because this
will return 2 anyway (input 'c' being the only NaN in this case).
For the cases where infzero was returning 3 to indicate "return
the default NaN", we must retain that "return 3".

For Arm, this looks like it might be a behaviour change because we
used to set float_flag_invalid | float_flag_invalid_imz only if C is
a quiet NaN.  However, it is not, because Arm target code never looks
at float_flag_invalid_imz, and for the (0 * inf) + SNaN case we
already raised float_flag_invalid via the "abc_mask &
float_cmask_snan" check in pick_nan_muladd.

For any target architecture using the "default implementation" at the
bottom of the ifdef, this is a behaviour change but will be fixing a
bug (where we failed to raise the Invalid exception for (0 * inf +
QNaN).  The architectures using the default case are:
 * hppa
 * i386
 * sh4
 * tricore

The x86, Tricore and SH4 CPU architecture manuals are clear that this
should have raised Invalid; HPPA is a bit vaguer but still seems
clear enough.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-2-peter.maydell@linaro.org
---
 fpu/softfloat-parts.c.inc      | 13 +++++++------
 fpu/softfloat-specialize.c.inc | 29 +----------------------------
 2 files changed, 8 insertions(+), 34 deletions(-)

diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-parts.c.inc
+++ b/fpu/softfloat-parts.c.inc
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
                                             int ab_mask, int abc_mask)
 {
     int which;
+    bool infzero = (ab_mask == float_cmask_infzero);
 
     if (unlikely(abc_mask & float_cmask_snan)) {
         float_raise(float_flag_invalid | float_flag_invalid_snan, s);
     }
 
-    which = pickNaNMulAdd(a->cls, b->cls, c->cls,
-                          ab_mask == float_cmask_infzero, s);
+    if (infzero) {
+        /* This is (0 * inf) + NaN or (inf * 0) + NaN */
+        float_raise(float_flag_invalid | float_flag_invalid_imz, s);
+    }
+
+    which = pickNaNMulAdd(a->cls, b->cls, c->cls, infzero, s);
 
     if (s->default_nan_mode || which == 3) {
-        /*
-         * Note that this check is after pickNaNMulAdd so that function
-         * has an opportunity to set the Invalid flag for infzero.
-         */
         parts_default_nan(a, s);
         return a;
     }
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
      * the default NaN
      */
     if (infzero && is_qnan(c_cls)) {
-        float_raise(float_flag_invalid | float_flag_invalid_imz, status);
         return 3;
     }
 
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
          * case sets InvalidOp and returns the default NaN
          */
         if (infzero) {
-            float_raise(float_flag_invalid | float_flag_invalid_imz, status);
             return 3;
         }
         /* Prefer sNaN over qNaN, in the a, b, c order. */
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
          * For MIPS systems that conform to IEEE754-2008, the (inf,zero,nan)
          * case sets InvalidOp and returns the input value 'c'
          */
-        if (infzero) {
-            float_raise(float_flag_invalid | float_flag_invalid_imz, status);
-            return 2;
-        }
         /* Prefer sNaN over qNaN, in the c, a, b order. */
         if (is_snan(c_cls)) {
             return 2;
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
      * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
      * case sets InvalidOp and returns the input value 'c'
      */
-    if (infzero) {
-        float_raise(float_flag_invalid | float_flag_invalid_imz, status);
-        return 2;
-    }
+
     /* Prefer sNaN over qNaN, in the c, a, b order. */
     if (is_snan(c_cls)) {
         return 2;
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
      * to return an input NaN if we have one (ie c) rather than generating
      * a default NaN
      */
-    if (infzero) {
-        float_raise(float_flag_invalid | float_flag_invalid_imz, status);
-        return 2;
-    }
 
     /* If fRA is a NaN return it; otherwise if fRB is a NaN return it;
      * otherwise return fRC. Note that muladd on PPC is (fRA * fRC) + frB
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
         return 1;
     }
 #elif defined(TARGET_RISCV)
-    /* For RISC-V, InvalidOp is set when multiplicands are Inf and zero */
-    if (infzero) {
-        float_raise(float_flag_invalid | float_flag_invalid_imz, status);
-    }
     return 3; /* default NaN */
 #elif defined(TARGET_S390X)
     if (infzero) {
-        float_raise(float_flag_invalid | float_flag_invalid_imz, status);
         return 3;
     }
 
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
         return 2;
     }
 #elif defined(TARGET_SPARC)
-    /* For (inf,0,nan) return c. */
-    if (infzero) {
-        float_raise(float_flag_invalid | float_flag_invalid_imz, status);
-        return 2;
-    }
     /* Prefer SNaN over QNaN, order C, B, A. */
     if (is_snan(c_cls)) {
         return 2;
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
      * For Xtensa, the (inf,zero,nan) case sets InvalidOp and returns
      * an input NaN if we have one (ie c).
      */
-    if (infzero) {
-        float_raise(float_flag_invalid | float_flag_invalid_imz, status);
-        return 2;
-    }
     if (status->use_first_nan) {
         if (is_nan(a_cls)) {
             return 0;
-- 
2.34.1

If the target sets default_nan_mode then we're always going to return
the default NaN, and pickNaNMulAdd() no longer has any side effects.
For consistency with pickNaN(), check for default_nan_mode before
calling pickNaNMulAdd().

When we convert pickNaNMulAdd() to allow runtime selection of the NaN
propagation rule, this means we won't have to make the targets which
use default_nan_mode also set a propagation rule.

Since RiscV always uses default_nan_mode, this allows us to remove
its ifdef case from pickNaNMulAdd().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-3-peter.maydell@linaro.org
---
 fpu/softfloat-parts.c.inc      | 8 ++++++--
 fpu/softfloat-specialize.c.inc | 9 +++++++--
 2 files changed, 13 insertions(+), 4 deletions(-)

diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-parts.c.inc
+++ b/fpu/softfloat-parts.c.inc
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
         float_raise(float_flag_invalid | float_flag_invalid_imz, s);
     }
 
-    which = pickNaNMulAdd(a->cls, b->cls, c->cls, infzero, s);
+    if (s->default_nan_mode) {
+        which = 3;
+    } else {
+        which = pickNaNMulAdd(a->cls, b->cls, c->cls, infzero, s);
+    }
 
-    if (s->default_nan_mode || which == 3) {
+    if (which == 3) {
         parts_default_nan(a, s);
         return a;
     }
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaN(FloatClass a_cls, FloatClass b_cls,
 static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
                          bool infzero, float_status *status)
 {
+    /*
+     * We guarantee not to require the target to tell us how to
+     * pick a NaN if we're always returning the default NaN.
+     * But if we're not in default-NaN mode then the target must
+     * specify.
+     */
+    assert(!status->default_nan_mode);
 #if defined(TARGET_ARM)
     /* For ARM, the (inf,zero,qnan) case sets InvalidOp and returns
      * the default NaN
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
     } else {
         return 1;
     }
-#elif defined(TARGET_RISCV)
-    return 3; /* default NaN */
 #elif defined(TARGET_S390X)
     if (infzero) {
         return 3;
-- 
2.34.1

IEEE 758 does not define a fixed rule for what NaN to return in
the case of a fused multiply-add of inf * 0 + NaN. Different
architectures thus do different things:
 * some return the default NaN
 * some return the input NaN
 * Arm returns the default NaN if the input NaN is quiet,
   and the input NaN if it is signalling

We want to make this logic be runtime selected rather than
hardcoded into the binary, because:
 * this will let us have multiple targets in one QEMU binary
 * the Arm FEAT_AFP architectural feature includes letting
   the guest select a NaN propagation rule at runtime

In this commit we add an enum for the propagation rule, the field in
float_status, and the corresponding getters and setters.  We change
pickNaNMulAdd to honour this, but because all targets still leave
this field at its default 0 value, the fallback logic will pick the
rule type with the old ifdef ladder.

Note that four architectures both use the muladd softfloat functions
and did not have a branch of the ifdef ladder to specify their
behaviour (and so were ending up with the "default" case, probably
wrongly): i386, HPPA, SH4 and Tricore.  SH4 and Tricore both set
default_nan_mode, and so will never get into pickNaNMulAdd().  For
HPPA and i386 we retain the same behaviour as the old default-case,
which is to not ever return the default NaN.  This might not be
correct but it is not a behaviour change.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-4-peter.maydell@linaro.org
---
 include/fpu/softfloat-helpers.h | 11 ++++
 include/fpu/softfloat-types.h   | 23 +++++++++
 fpu/softfloat-specialize.c.inc  | 91 ++++++++++++++++++++++-----------
 3 files changed, 95 insertions(+), 30 deletions(-)

diff --git a/include/fpu/softfloat-helpers.h b/include/fpu/softfloat-helpers.h
index XXXXXXX..XXXXXXX 100644
--- a/include/fpu/softfloat-helpers.h
+++ b/include/fpu/softfloat-helpers.h
@@ -XXX,XX +XXX,XX @@ static inline void set_float_2nan_prop_rule(Float2NaNPropRule rule,
     status->float_2nan_prop_rule = rule;
 }
 
+static inline void set_float_infzeronan_rule(FloatInfZeroNaNRule rule,
+                                             float_status *status)
+{
+    status->float_infzeronan_rule = rule;
+}
+
 static inline void set_flush_to_zero(bool val, float_status *status)
 {
     status->flush_to_zero = val;
@@ -XXX,XX +XXX,XX @@ static inline Float2NaNPropRule get_float_2nan_prop_rule(float_status *status)
     return status->float_2nan_prop_rule;
 }
 
+static inline FloatInfZeroNaNRule get_float_infzeronan_rule(float_status *status)
+{
+    return status->float_infzeronan_rule;
+}
+
 static inline bool get_flush_to_zero(float_status *status)
 {
     return status->flush_to_zero;
diff --git a/include/fpu/softfloat-types.h b/include/fpu/softfloat-types.h
index XXXXXXX..XXXXXXX 100644
--- a/include/fpu/softfloat-types.h
+++ b/include/fpu/softfloat-types.h
@@ -XXX,XX +XXX,XX @@ typedef enum __attribute__((__packed__)) {
     float_2nan_prop_x87,
 } Float2NaNPropRule;
 
+/*
+ * Rule for result of fused multiply-add 0 * Inf + NaN.
+ * This must be a NaN, but implementations differ on whether this
+ * is the input NaN or the default NaN.
+ *
+ * You don't need to set this if default_nan_mode is enabled.
+ * When not in default-NaN mode, it is an error for the target
+ * not to set the rule in float_status if it uses muladd, and we
+ * will assert if we need to handle an input NaN and no rule was
+ * selected.
+ */
+typedef enum __attribute__((__packed__)) {
+    /* No propagation rule specified */
+    float_infzeronan_none = 0,
+    /* Result is never the default NaN (so always the input NaN) */
+    float_infzeronan_dnan_never,
+    /* Result is always the default NaN */
+    float_infzeronan_dnan_always,
+    /* Result is the default NaN if the input NaN is quiet */
+    float_infzeronan_dnan_if_qnan,
+} FloatInfZeroNaNRule;
+
 /*
  * Floating Point Status. Individual architectures may maintain
  * several versions of float_status for different functions. The
@@ -XXX,XX +XXX,XX @@ typedef struct float_status {
     FloatRoundMode float_rounding_mode;
     FloatX80RoundPrec floatx80_rounding_precision;
     Float2NaNPropRule float_2nan_prop_rule;
+    FloatInfZeroNaNRule float_infzeronan_rule;
     bool tininess_before_rounding;
     /* should denormalised results go to zero and set the inexact flag? */
     bool flush_to_zero;
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaN(FloatClass a_cls, FloatClass b_cls,
 static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
                          bool infzero, float_status *status)
 {
+    FloatInfZeroNaNRule rule = status->float_infzeronan_rule;
+
     /*
      * We guarantee not to require the target to tell us how to
      * pick a NaN if we're always returning the default NaN.
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
      * specify.
      */
     assert(!status->default_nan_mode);
+
+    if (rule == float_infzeronan_none) {
+        /*
+         * Temporarily fall back to ifdef ladder
+         */
 #if defined(TARGET_ARM)
-    /* For ARM, the (inf,zero,qnan) case sets InvalidOp and returns
-     * the default NaN
-     */
-    if (infzero && is_qnan(c_cls)) {
-        return 3;
+        /*
+         * For ARM, the (inf,zero,qnan) case returns the default NaN,
+         * but (inf,zero,snan) returns the input NaN.
+         */
+        rule = float_infzeronan_dnan_if_qnan;
+#elif defined(TARGET_MIPS)
+        if (snan_bit_is_one(status)) {
+            /*
+             * For MIPS systems that conform to IEEE754-1985, the (inf,zero,nan)
+             * case sets InvalidOp and returns the default NaN
+             */
+            rule = float_infzeronan_dnan_always;
+        } else {
+            /*
+             * For MIPS systems that conform to IEEE754-2008, the (inf,zero,nan)
+             * case sets InvalidOp and returns the input value 'c'
+             */
+            rule = float_infzeronan_dnan_never;
+        }
+#elif defined(TARGET_PPC) || defined(TARGET_SPARC) || \
+    defined(TARGET_XTENSA) || defined(TARGET_HPPA) || \
+    defined(TARGET_I386) || defined(TARGET_LOONGARCH)
+        /*
+         * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
+         * case sets InvalidOp and returns the input value 'c'
+         */
+        /*
+         * For PPC, the (inf,zero,qnan) case sets InvalidOp, but we prefer
+         * to return an input NaN if we have one (ie c) rather than generating
+         * a default NaN
+         */
+        rule = float_infzeronan_dnan_never;
+#elif defined(TARGET_S390X)
+        rule = float_infzeronan_dnan_always;
+#endif
     }
 
+    if (infzero) {
+        /*
+         * Inf * 0 + NaN -- some implementations return the default NaN here,
+         * and some return the input NaN.
+         */
+        switch (rule) {
+        case float_infzeronan_dnan_never:
+            return 2;
+        case float_infzeronan_dnan_always:
+            return 3;
+        case float_infzeronan_dnan_if_qnan:
+            return is_qnan(c_cls) ? 3 : 2;
+        default:
+            g_assert_not_reached();
+        }
+    }
+
+#if defined(TARGET_ARM)
+
     /* This looks different from the ARM ARM pseudocode, because the ARM ARM
      * puts the operands to a fused mac operation (a*b)+c in the order c,a,b.
      */
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
     }
 #elif defined(TARGET_MIPS)
     if (snan_bit_is_one(status)) {
-        /*
-         * For MIPS systems that conform to IEEE754-1985, the (inf,zero,nan)
-         * case sets InvalidOp and returns the default NaN
-         */
-        if (infzero) {
-            return 3;
-        }
         /* Prefer sNaN over qNaN, in the a, b, c order. */
         if (is_snan(a_cls)) {
             return 0;
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
             return 2;
         }
     } else {
-        /*
-         * For MIPS systems that conform to IEEE754-2008, the (inf,zero,nan)
-         * case sets InvalidOp and returns the input value 'c'
-         */
         /* Prefer sNaN over qNaN, in the c, a, b order. */
         if (is_snan(c_cls)) {
             return 2;
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
         }
     }
 #elif defined(TARGET_LOONGARCH64)
-    /*
-     * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
-     * case sets InvalidOp and returns the input value 'c'
-     */
-
     /* Prefer sNaN over qNaN, in the c, a, b order. */
     if (is_snan(c_cls)) {
         return 2;
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
         return 1;
     }
 #elif defined(TARGET_PPC)
-    /* For PPC, the (inf,zero,qnan) case sets InvalidOp, but we prefer
-     * to return an input NaN if we have one (ie c) rather than generating
-     * a default NaN
-     */
-
     /* If fRA is a NaN return it; otherwise if fRB is a NaN return it;
      * otherwise return fRC. Note that muladd on PPC is (fRA * fRC) + frB
      */
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
         return 1;
     }
 #elif defined(TARGET_S390X)
-    if (infzero) {
-        return 3;
-    }
-
     if (is_snan(a_cls)) {
         return 0;
     } else if (is_snan(b_cls)) {
-- 
2.34.1

Explicitly set a rule in the softfloat tests for the inf-zero-nan
muladd special case.  In meson.build we put -DTARGET_ARM in fpcflags,
and so we should select here the Arm rule of
float_infzeronan_dnan_if_qnan.

Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20241202131347.498124-5-peter.maydell@linaro.org
---
 tests/fp/fp-bench.c | 5 +++++
 tests/fp/fp-test.c  | 5 +++++
 2 files changed, 10 insertions(+)

diff --git a/tests/fp/fp-bench.c b/tests/fp/fp-bench.c
index XXXXXXX..XXXXXXX 100644
--- a/tests/fp/fp-bench.c
+++ b/tests/fp/fp-bench.c
@@ -XXX,XX +XXX,XX @@ static void run_bench(void)
 {
     bench_func_t f;
 
+    /*
+     * These implementation-defined choices for various things IEEE
+     * doesn't specify match those used by the Arm architecture.
+     */
     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &soft_status);
+    set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, &soft_status);
 
     f = bench_funcs[operation][precision];
     g_assert(f);
diff --git a/tests/fp/fp-test.c b/tests/fp/fp-test.c
index XXXXXXX..XXXXXXX 100644
--- a/tests/fp/fp-test.c
+++ b/tests/fp/fp-test.c
@@ -XXX,XX +XXX,XX @@ void run_test(void)
 {
     unsigned int i;
 
+    /*
+     * These implementation-defined choices for various things IEEE
+     * doesn't specify match those used by the Arm architecture.
+     */
     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &qsf);
+    set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, &qsf);
 
     genCases_setLevel(test_level);
     verCases_maxErrorCount = n_max_errors;
-- 
2.34.1

Set the FloatInfZeroNaNRule explicitly for the Arm target,
so we can remove the ifdef from pickNaNMulAdd().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-6-peter.maydell@linaro.org
---
 target/arm/cpu.c               | 3 +++
 fpu/softfloat-specialize.c.inc | 8 +-------
 2 files changed, 4 insertions(+), 7 deletions(-)

diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ void arm_register_el_change_hook(ARMCPU *cpu, ARMELChangeHookFn *hook,
  *  * tininess-before-rounding
  *  * 2-input NaN propagation prefers SNaN over QNaN, and then
  *    operand A over operand B (see FPProcessNaNs() pseudocode)
+ *  * 0 * Inf + NaN returns the default NaN if the input NaN is quiet,
+ *    and the input NaN if it is signalling
  */
 static void arm_set_default_fp_behaviours(float_status *s)
 {
     set_float_detect_tininess(float_tininess_before_rounding, s);
     set_float_2nan_prop_rule(float_2nan_prop_s_ab, s);
+    set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, s);
 }
 
 static void cp_reg_reset(gpointer key, gpointer value, gpointer opaque)
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
         /*
          * Temporarily fall back to ifdef ladder
          */
-#if defined(TARGET_ARM)
-        /*
-         * For ARM, the (inf,zero,qnan) case returns the default NaN,
-         * but (inf,zero,snan) returns the input NaN.
-         */
-        rule = float_infzeronan_dnan_if_qnan;
-#elif defined(TARGET_MIPS)
+#if defined(TARGET_MIPS)
         if (snan_bit_is_one(status)) {
             /*
              * For MIPS systems that conform to IEEE754-1985, the (inf,zero,nan)
-- 
2.34.1

Set the FloatInfZeroNaNRule explicitly for s390, so we
can remove the ifdef from pickNaNMulAdd().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-7-peter.maydell@linaro.org
---
 target/s390x/cpu.c             | 2 ++
 fpu/softfloat-specialize.c.inc | 2 --
 2 files changed, 2 insertions(+), 2 deletions(-)

diff --git a/target/s390x/cpu.c b/target/s390x/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/s390x/cpu.c
+++ b/target/s390x/cpu.c
@@ -XXX,XX +XXX,XX @@ static void s390_cpu_reset_hold(Object *obj, ResetType type)
         set_float_detect_tininess(float_tininess_before_rounding,
                                   &env->fpu_status);
         set_float_2nan_prop_rule(float_2nan_prop_s_ab, &env->fpu_status);
+        set_float_infzeronan_rule(float_infzeronan_dnan_always,
+                                  &env->fpu_status);
        /* fall through */
     case RESET_TYPE_S390_CPU_NORMAL:
         env->psw.mask &= ~PSW_MASK_RI;
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
          * a default NaN
          */
         rule = float_infzeronan_dnan_never;
-#elif defined(TARGET_S390X)
-        rule = float_infzeronan_dnan_always;
 #endif
     }
 
-- 
2.34.1

Set the FloatInfZeroNaNRule explicitly for the PPC target,
so we can remove the ifdef from pickNaNMulAdd().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-8-peter.maydell@linaro.org
---
 target/ppc/cpu_init.c          | 7 +++++++
 fpu/softfloat-specialize.c.inc | 7 +------
 2 files changed, 8 insertions(+), 6 deletions(-)

diff --git a/target/ppc/cpu_init.c b/target/ppc/cpu_init.c
index XXXXXXX..XXXXXXX 100644
--- a/target/ppc/cpu_init.c
+++ b/target/ppc/cpu_init.c
@@ -XXX,XX +XXX,XX @@ static void ppc_cpu_reset_hold(Object *obj, ResetType type)
      */
     set_float_2nan_prop_rule(float_2nan_prop_ab, &env->fp_status);
     set_float_2nan_prop_rule(float_2nan_prop_ab, &env->vec_status);
+    /*
+     * For PPC, the (inf,zero,qnan) case sets InvalidOp, but we prefer
+     * to return an input NaN if we have one (ie c) rather than generating
+     * a default NaN
+     */
+    set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
+    set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->vec_status);
 
     for (i = 0; i < ARRAY_SIZE(env->spr_cb); i++) {
         ppc_spr_t *spr = &env->spr_cb[i];
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
              */
             rule = float_infzeronan_dnan_never;
         }
-#elif defined(TARGET_PPC) || defined(TARGET_SPARC) || \
+#elif defined(TARGET_SPARC) || \
     defined(TARGET_XTENSA) || defined(TARGET_HPPA) || \
     defined(TARGET_I386) || defined(TARGET_LOONGARCH)
         /*
          * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
          * case sets InvalidOp and returns the input value 'c'
          */
-        /*
-         * For PPC, the (inf,zero,qnan) case sets InvalidOp, but we prefer
-         * to return an input NaN if we have one (ie c) rather than generating
-         * a default NaN
-         */
         rule = float_infzeronan_dnan_never;
 #endif
     }
-- 
2.34.1

Set the FloatInfZeroNaNRule explicitly for the MIPS target,
so we can remove the ifdef from pickNaNMulAdd().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-9-peter.maydell@linaro.org
---
 target/mips/fpu_helper.h       |  9 +++++++++
 target/mips/msa.c              |  4 ++++
 fpu/softfloat-specialize.c.inc | 16 +---------------
 3 files changed, 14 insertions(+), 15 deletions(-)

diff --git a/target/mips/fpu_helper.h b/target/mips/fpu_helper.h
index XXXXXXX..XXXXXXX 100644
--- a/target/mips/fpu_helper.h
+++ b/target/mips/fpu_helper.h
@@ -XXX,XX +XXX,XX @@ static inline void restore_flush_mode(CPUMIPSState *env)
 static inline void restore_snan_bit_mode(CPUMIPSState *env)
 {
     bool nan2008 = env->active_fpu.fcr31 & (1 << FCR31_NAN2008);
+    FloatInfZeroNaNRule izn_rule;
 
     /*
      * With nan2008, SNaNs are silenced in the usual way.
@@ -XXX,XX +XXX,XX @@ static inline void restore_snan_bit_mode(CPUMIPSState *env)
      */
     set_snan_bit_is_one(!nan2008, &env->active_fpu.fp_status);
     set_default_nan_mode(!nan2008, &env->active_fpu.fp_status);
+    /*
+     * For MIPS systems that conform to IEEE754-1985, the (inf,zero,nan)
+     * case sets InvalidOp and returns the default NaN.
+     * For MIPS systems that conform to IEEE754-2008, the (inf,zero,nan)
+     * case sets InvalidOp and returns the input value 'c'.
+     */
+    izn_rule = nan2008 ? float_infzeronan_dnan_never : float_infzeronan_dnan_always;
+    set_float_infzeronan_rule(izn_rule, &env->active_fpu.fp_status);
 }
 
 static inline void restore_fp_status(CPUMIPSState *env)
diff --git a/target/mips/msa.c b/target/mips/msa.c
index XXXXXXX..XXXXXXX 100644
--- a/target/mips/msa.c
+++ b/target/mips/msa.c
@@ -XXX,XX +XXX,XX @@ void msa_reset(CPUMIPSState *env)
 
     /* set proper signanling bit meaning ("1" means "quiet") */
     set_snan_bit_is_one(0, &env->active_tc.msa_fp_status);
+
+    /* Inf * 0 + NaN returns the input NaN */
+    set_float_infzeronan_rule(float_infzeronan_dnan_never,
+                              &env->active_tc.msa_fp_status);
 }
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
         /*
          * Temporarily fall back to ifdef ladder
          */
-#if defined(TARGET_MIPS)
-        if (snan_bit_is_one(status)) {
-            /*
-             * For MIPS systems that conform to IEEE754-1985, the (inf,zero,nan)
-             * case sets InvalidOp and returns the default NaN
-             */
-            rule = float_infzeronan_dnan_always;
-        } else {
-            /*
-             * For MIPS systems that conform to IEEE754-2008, the (inf,zero,nan)
-             * case sets InvalidOp and returns the input value 'c'
-             */
-            rule = float_infzeronan_dnan_never;
-        }
-#elif defined(TARGET_SPARC) || \
+#if defined(TARGET_SPARC) || \
     defined(TARGET_XTENSA) || defined(TARGET_HPPA) || \
     defined(TARGET_I386) || defined(TARGET_LOONGARCH)
         /*
-- 
2.34.1

Set the FloatInfZeroNaNRule explicitly for the SPARC target,
so we can remove the ifdef from pickNaNMulAdd().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-10-peter.maydell@linaro.org
---
 target/sparc/cpu.c             | 2 ++
 fpu/softfloat-specialize.c.inc | 3 +--
 2 files changed, 3 insertions(+), 2 deletions(-)

diff --git a/target/sparc/cpu.c b/target/sparc/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/sparc/cpu.c
+++ b/target/sparc/cpu.c
@@ -XXX,XX +XXX,XX @@ static void sparc_cpu_realizefn(DeviceState *dev, Error **errp)
      * the CPU state struct so it won't get zeroed on reset.
      */
     set_float_2nan_prop_rule(float_2nan_prop_s_ba, &env->fp_status);
+    /* For inf * 0 + NaN, return the input NaN */
+    set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
 
     cpu_exec_realizefn(cs, &local_err);
     if (local_err != NULL) {
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
         /*
          * Temporarily fall back to ifdef ladder
          */
-#if defined(TARGET_SPARC) || \
-    defined(TARGET_XTENSA) || defined(TARGET_HPPA) || \
+#if defined(TARGET_XTENSA) || defined(TARGET_HPPA) || \
     defined(TARGET_I386) || defined(TARGET_LOONGARCH)
         /*
          * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
-- 
2.34.1

Set the FloatInfZeroNaNRule explicitly for the xtensa target,
so we can remove the ifdef from pickNaNMulAdd().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-11-peter.maydell@linaro.org
---
 target/xtensa/cpu.c            | 2 ++
 fpu/softfloat-specialize.c.inc | 2 +-
 2 files changed, 3 insertions(+), 1 deletion(-)

diff --git a/target/xtensa/cpu.c b/target/xtensa/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/xtensa/cpu.c
+++ b/target/xtensa/cpu.c
@@ -XXX,XX +XXX,XX @@ static void xtensa_cpu_reset_hold(Object *obj, ResetType type)
     reset_mmu(env);
     cs->halted = env->runstall;
 #endif
+    /* For inf * 0 + NaN, return the input NaN */
+    set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
     set_no_signaling_nans(!dfpu, &env->fp_status);
     xtensa_use_first_nan(env, !dfpu);
 }
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
         /*
          * Temporarily fall back to ifdef ladder
          */
-#if defined(TARGET_XTENSA) || defined(TARGET_HPPA) || \
+#if defined(TARGET_HPPA) || \
     defined(TARGET_I386) || defined(TARGET_LOONGARCH)
         /*
          * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
-- 
2.34.1

Set the FloatInfZeroNaNRule explicitly for the x86 target.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-12-peter.maydell@linaro.org
---
 target/i386/tcg/fpu_helper.c   | 7 +++++++
 fpu/softfloat-specialize.c.inc | 2 +-
 2 files changed, 8 insertions(+), 1 deletion(-)

diff --git a/target/i386/tcg/fpu_helper.c b/target/i386/tcg/fpu_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/i386/tcg/fpu_helper.c
+++ b/target/i386/tcg/fpu_helper.c
@@ -XXX,XX +XXX,XX @@ void cpu_init_fp_statuses(CPUX86State *env)
      */
     set_float_2nan_prop_rule(float_2nan_prop_x87, &env->mmx_status);
     set_float_2nan_prop_rule(float_2nan_prop_x87, &env->sse_status);
+    /*
+     * Only SSE has multiply-add instructions. In the SDM Section 14.5.2
+     * "Fused-Multiply-ADD (FMA) Numeric Behavior" the NaN handling is
+     * specified -- for 0 * inf + NaN the input NaN is selected, and if
+     * there are multiple input NaNs they are selected in the order a, b, c.
+     */
+    set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->sse_status);
 }
 
 static inline uint8_t save_exception_flags(CPUX86State *env)
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
          * Temporarily fall back to ifdef ladder
          */
 #if defined(TARGET_HPPA) || \
-    defined(TARGET_I386) || defined(TARGET_LOONGARCH)
+    defined(TARGET_LOONGARCH)
         /*
          * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
          * case sets InvalidOp and returns the input value 'c'
-- 
2.34.1

Set the FloatInfZeroNaNRule explicitly for the loongarch target.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-13-peter.maydell@linaro.org
---
 target/loongarch/tcg/fpu_helper.c | 5 +++++
 fpu/softfloat-specialize.c.inc    | 7 +------
 2 files changed, 6 insertions(+), 6 deletions(-)

diff --git a/target/loongarch/tcg/fpu_helper.c b/target/loongarch/tcg/fpu_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/loongarch/tcg/fpu_helper.c
+++ b/target/loongarch/tcg/fpu_helper.c
@@ -XXX,XX +XXX,XX @@ void restore_fp_status(CPULoongArchState *env)
                             &env->fp_status);
     set_flush_to_zero(0, &env->fp_status);
     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &env->fp_status);
+    /*
+     * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
+     * case sets InvalidOp and returns the input value 'c'
+     */
+    set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
 }
 
 int ieee_ex_to_loongarch(int xcpt)
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
         /*
          * Temporarily fall back to ifdef ladder
          */
-#if defined(TARGET_HPPA) || \
-    defined(TARGET_LOONGARCH)
-        /*
-         * For LoongArch systems that conform to IEEE754-2008, the (inf,zero,nan)
-         * case sets InvalidOp and returns the input value 'c'
-         */
+#if defined(TARGET_HPPA)
         rule = float_infzeronan_dnan_never;
 #endif
     }
-- 
2.34.1

Set the FloatInfZeroNaNRule explicitly for the HPPA target,
so we can remove the ifdef from pickNaNMulAdd().

As this is the last target to be converted to explicitly setting
the rule, we can remove the fallback code in pickNaNMulAdd()
entirely.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-14-peter.maydell@linaro.org
---
 target/hppa/fpu_helper.c       |  2 ++
 fpu/softfloat-specialize.c.inc | 13 +------------
 2 files changed, 3 insertions(+), 12 deletions(-)

diff --git a/target/hppa/fpu_helper.c b/target/hppa/fpu_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/hppa/fpu_helper.c
+++ b/target/hppa/fpu_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(loaded_fr0)(CPUHPPAState *env)
      * HPPA does note implement a CPU reset method at all...
      */
     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &env->fp_status);
+    /* For inf * 0 + NaN, return the input NaN */
+    set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
 }
 
 void cpu_hppa_loaded_fr0(CPUHPPAState *env)
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaN(FloatClass a_cls, FloatClass b_cls,
 static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
                          bool infzero, float_status *status)
 {
-    FloatInfZeroNaNRule rule = status->float_infzeronan_rule;
-
     /*
      * We guarantee not to require the target to tell us how to
      * pick a NaN if we're always returning the default NaN.
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
      */
     assert(!status->default_nan_mode);
 
-    if (rule == float_infzeronan_none) {
-        /*
-         * Temporarily fall back to ifdef ladder
-         */
-#if defined(TARGET_HPPA)
-        rule = float_infzeronan_dnan_never;
-#endif
-    }
-
     if (infzero) {
         /*
          * Inf * 0 + NaN -- some implementations return the default NaN here,
          * and some return the input NaN.
          */
-        switch (rule) {
+        switch (status->float_infzeronan_rule) {
         case float_infzeronan_dnan_never:
             return 2;
         case float_infzeronan_dnan_always:
-- 
2.34.1

The new implementation of pickNaNMulAdd() will find it convenient
to know whether at least one of the three arguments to the muladd
was a signaling NaN. We already calculate that in the caller,
so pass it in as a new bool have_snan.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-15-peter.maydell@linaro.org
---
 fpu/softfloat-parts.c.inc      | 5 +++--
 fpu/softfloat-specialize.c.inc | 2 +-
 2 files changed, 4 insertions(+), 3 deletions(-)

diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-parts.c.inc
+++ b/fpu/softfloat-parts.c.inc
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
 {
     int which;
     bool infzero = (ab_mask == float_cmask_infzero);
+    bool have_snan = (abc_mask & float_cmask_snan);
 
-    if (unlikely(abc_mask & float_cmask_snan)) {
+    if (unlikely(have_snan)) {
         float_raise(float_flag_invalid | float_flag_invalid_snan, s);
     }
 
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
     if (s->default_nan_mode) {
         which = 3;
     } else {
-        which = pickNaNMulAdd(a->cls, b->cls, c->cls, infzero, s);
+        which = pickNaNMulAdd(a->cls, b->cls, c->cls, infzero, have_snan, s);
     }
 
     if (which == 3) {
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaN(FloatClass a_cls, FloatClass b_cls,
 | Return values : 0 : a; 1 : b; 2 : c; 3 : default-NaN
 *----------------------------------------------------------------------------*/
 static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
-                         bool infzero, float_status *status)
+                         bool infzero, bool have_snan, float_status *status)
 {
     /*
      * We guarantee not to require the target to tell us how to
-- 
2.34.1

IEEE 758 does not define a fixed rule for which NaN to pick as the
result if both operands of a 3-operand fused multiply-add operation
are NaNs.  As a result different architectures have ended up with
different rules for propagating NaNs.

QEMU currently hardcodes the NaN propagation logic into the binary
because pickNaNMulAdd() has an ifdef ladder for different targets.
We want to make the propagation rule instead be selectable at
runtime, because:
 * this will let us have multiple targets in one QEMU binary
 * the Arm FEAT_AFP architectural feature includes letting
   the guest select a NaN propagation rule at runtime

It's valid not to set a propagation rule if default_nan_mode is
enabled, because in that case there's no need to pick a NaN; all the
callers of pickNaNMulAdd() catch this case and skip calling it.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-16-peter.maydell@linaro.org
---
 include/fpu/softfloat-helpers.h |  11 +++
 include/fpu/softfloat-types.h   |  55 +++++++++++
 fpu/softfloat-specialize.c.inc  | 167 ++++++++------------------------
 3 files changed, 107 insertions(+), 126 deletions(-)

diff --git a/include/fpu/softfloat-helpers.h b/include/fpu/softfloat-helpers.h
index XXXXXXX..XXXXXXX 100644
--- a/include/fpu/softfloat-helpers.h
+++ b/include/fpu/softfloat-helpers.h
@@ -XXX,XX +XXX,XX @@ static inline void set_float_2nan_prop_rule(Float2NaNPropRule rule,
     status->float_2nan_prop_rule = rule;
 }
 
+static inline void set_float_3nan_prop_rule(Float3NaNPropRule rule,
+                                            float_status *status)
+{
+    status->float_3nan_prop_rule = rule;
+}
+
 static inline void set_float_infzeronan_rule(FloatInfZeroNaNRule rule,
                                              float_status *status)
 {
@@ -XXX,XX +XXX,XX @@ static inline Float2NaNPropRule get_float_2nan_prop_rule(float_status *status)
     return status->float_2nan_prop_rule;
 }
 
+static inline Float3NaNPropRule get_float_3nan_prop_rule(float_status *status)
+{
+    return status->float_3nan_prop_rule;
+}
+
 static inline FloatInfZeroNaNRule get_float_infzeronan_rule(float_status *status)
 {
     return status->float_infzeronan_rule;
diff --git a/include/fpu/softfloat-types.h b/include/fpu/softfloat-types.h
index XXXXXXX..XXXXXXX 100644
--- a/include/fpu/softfloat-types.h
+++ b/include/fpu/softfloat-types.h
@@ -XXX,XX +XXX,XX @@ this code that are retained.
 #ifndef SOFTFLOAT_TYPES_H
 #define SOFTFLOAT_TYPES_H
 
+#include "hw/registerfields.h"
+
 /*
  * Software IEC/IEEE floating-point types.
  */
@@ -XXX,XX +XXX,XX @@ typedef enum __attribute__((__packed__)) {
     float_2nan_prop_x87,
 } Float2NaNPropRule;
 
+/*
+ * 3-input NaN propagation rule, for fused multiply-add. Individual
+ * architectures have different rules for which input NaN is
+ * propagated to the output when there is more than one NaN on the
+ * input.
+ *
+ * If default_nan_mode is enabled then it is valid not to set a NaN
+ * propagation rule, because the softfloat code guarantees not to try
+ * to pick a NaN to propagate in default NaN mode.  When not in
+ * default-NaN mode, it is an error for the target not to set the rule
+ * in float_status if it uses a muladd, and we will assert if we need
+ * to handle an input NaN and no rule was selected.
+ *
+ * The naming scheme for Float3NaNPropRule values is:
+ *  float_3nan_prop_s_abc:
+ *    = "Prefer SNaN over QNaN, then operand A over B over C"
+ *  float_3nan_prop_abc:
+ *    = "Prefer A over B over C regardless of SNaN vs QNAN"
+ *
+ * For QEMU, the multiply-add operation is A * B + C.
+ */
+
+/*
+ * We set the Float3NaNPropRule enum values up so we can select the
+ * right value in pickNaNMulAdd in a data driven way.
+ */
+FIELD(3NAN, 1ST, 0, 2)   /* which operand is most preferred ? */
+FIELD(3NAN, 2ND, 2, 2)   /* which operand is next most preferred ? */
+FIELD(3NAN, 3RD, 4, 2)   /* which operand is least preferred ? */
+FIELD(3NAN, SNAN, 6, 1)  /* do we prefer SNaN over QNaN ? */
+
+#define PROPRULE(X, Y, Z) \
+    ((X << R_3NAN_1ST_SHIFT) | (Y << R_3NAN_2ND_SHIFT) | (Z << R_3NAN_3RD_SHIFT))
+
+typedef enum __attribute__((__packed__)) {
+    float_3nan_prop_none = 0,     /* No propagation rule specified */
+    float_3nan_prop_abc = PROPRULE(0, 1, 2),
+    float_3nan_prop_acb = PROPRULE(0, 2, 1),
+    float_3nan_prop_bac = PROPRULE(1, 0, 2),
+    float_3nan_prop_bca = PROPRULE(1, 2, 0),
+    float_3nan_prop_cab = PROPRULE(2, 0, 1),
+    float_3nan_prop_cba = PROPRULE(2, 1, 0),
+    float_3nan_prop_s_abc = float_3nan_prop_abc | R_3NAN_SNAN_MASK,
+    float_3nan_prop_s_acb = float_3nan_prop_acb | R_3NAN_SNAN_MASK,
+    float_3nan_prop_s_bac = float_3nan_prop_bac | R_3NAN_SNAN_MASK,
+    float_3nan_prop_s_bca = float_3nan_prop_bca | R_3NAN_SNAN_MASK,
+    float_3nan_prop_s_cab = float_3nan_prop_cab | R_3NAN_SNAN_MASK,
+    float_3nan_prop_s_cba = float_3nan_prop_cba | R_3NAN_SNAN_MASK,
+} Float3NaNPropRule;
+
+#undef PROPRULE
+
 /*
  * Rule for result of fused multiply-add 0 * Inf + NaN.
  * This must be a NaN, but implementations differ on whether this
@@ -XXX,XX +XXX,XX @@ typedef struct float_status {
     FloatRoundMode float_rounding_mode;
     FloatX80RoundPrec floatx80_rounding_precision;
     Float2NaNPropRule float_2nan_prop_rule;
+    Float3NaNPropRule float_3nan_prop_rule;
     FloatInfZeroNaNRule float_infzeronan_rule;
     bool tininess_before_rounding;
     /* should denormalised results go to zero and set the inexact flag? */
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaN(FloatClass a_cls, FloatClass b_cls,
 static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
                          bool infzero, bool have_snan, float_status *status)
 {
+    FloatClass cls[3] = { a_cls, b_cls, c_cls };
+    Float3NaNPropRule rule = status->float_3nan_prop_rule;
+    int which;
+
     /*
      * We guarantee not to require the target to tell us how to
      * pick a NaN if we're always returning the default NaN.
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
         }
     }
 
+    if (rule == float_3nan_prop_none) {
 #if defined(TARGET_ARM)
-
-    /* This looks different from the ARM ARM pseudocode, because the ARM ARM
-     * puts the operands to a fused mac operation (a*b)+c in the order c,a,b.
-     */
-    if (is_snan(c_cls)) {
-        return 2;
-    } else if (is_snan(a_cls)) {
-        return 0;
-    } else if (is_snan(b_cls)) {
-        return 1;
-    } else if (is_qnan(c_cls)) {
-        return 2;
-    } else if (is_qnan(a_cls)) {
-        return 0;
-    } else {
-        return 1;
-    }
+        /*
+         * This looks different from the ARM ARM pseudocode, because the ARM ARM
+         * puts the operands to a fused mac operation (a*b)+c in the order c,a,b
+         */
+        rule = float_3nan_prop_s_cab;
 #elif defined(TARGET_MIPS)
-    if (snan_bit_is_one(status)) {
-        /* Prefer sNaN over qNaN, in the a, b, c order. */
-        if (is_snan(a_cls)) {
-            return 0;
-        } else if (is_snan(b_cls)) {
-            return 1;
-        } else if (is_snan(c_cls)) {
-            return 2;
-        } else if (is_qnan(a_cls)) {
-            return 0;
-        } else if (is_qnan(b_cls)) {
-            return 1;
+        if (snan_bit_is_one(status)) {
+            rule = float_3nan_prop_s_abc;
         } else {
-            return 2;
+            rule = float_3nan_prop_s_cab;
         }
-    } else {
-        /* Prefer sNaN over qNaN, in the c, a, b order. */
-        if (is_snan(c_cls)) {
-            return 2;
-        } else if (is_snan(a_cls)) {
-            return 0;
-        } else if (is_snan(b_cls)) {
-            return 1;
-        } else if (is_qnan(c_cls)) {
-            return 2;
-        } else if (is_qnan(a_cls)) {
-            return 0;
-        } else {
-            return 1;
-        }
-    }
 #elif defined(TARGET_LOONGARCH64)
-    /* Prefer sNaN over qNaN, in the c, a, b order. */
-    if (is_snan(c_cls)) {
-        return 2;
-    } else if (is_snan(a_cls)) {
-        return 0;
-    } else if (is_snan(b_cls)) {
-        return 1;
-    } else if (is_qnan(c_cls)) {
-        return 2;
-    } else if (is_qnan(a_cls)) {
-        return 0;
-    } else {
-        return 1;
-    }
+        rule = float_3nan_prop_s_cab;
 #elif defined(TARGET_PPC)
-    /* If fRA is a NaN return it; otherwise if fRB is a NaN return it;
-     * otherwise return fRC. Note that muladd on PPC is (fRA * fRC) + frB
-     */
-    if (is_nan(a_cls)) {
-        return 0;
-    } else if (is_nan(c_cls)) {
-        return 2;
-    } else {
-        return 1;
-    }
+        /*
+         * If fRA is a NaN return it; otherwise if fRB is a NaN return it;
+         * otherwise return fRC. Note that muladd on PPC is (fRA * fRC) + frB
+         */
+        rule = float_3nan_prop_acb;
 #elif defined(TARGET_S390X)
-    if (is_snan(a_cls)) {
-        return 0;
-    } else if (is_snan(b_cls)) {
-        return 1;
-    } else if (is_snan(c_cls)) {
-        return 2;
-    } else if (is_qnan(a_cls)) {
-        return 0;
-    } else if (is_qnan(b_cls)) {
-        return 1;
-    } else {
-        return 2;
-    }
+        rule = float_3nan_prop_s_abc;
 #elif defined(TARGET_SPARC)
-    /* Prefer SNaN over QNaN, order C, B, A. */
-    if (is_snan(c_cls)) {
-        return 2;
-    } else if (is_snan(b_cls)) {
-        return 1;
-    } else if (is_snan(a_cls)) {
-        return 0;
-    } else if (is_qnan(c_cls)) {
-        return 2;
-    } else if (is_qnan(b_cls)) {
-        return 1;
-    } else {
-        return 0;
-    }
+        rule = float_3nan_prop_s_cba;
 #elif defined(TARGET_XTENSA)
-    /*
-     * For Xtensa, the (inf,zero,nan) case sets InvalidOp and returns
-     * an input NaN if we have one (ie c).
-     */
-    if (status->use_first_nan) {
-        if (is_nan(a_cls)) {
-            return 0;
-        } else if (is_nan(b_cls)) {
-            return 1;
+        if (status->use_first_nan) {
+            rule = float_3nan_prop_abc;
         } else {
-            return 2;
+            rule = float_3nan_prop_cba;
         }
-    } else {
-        if (is_nan(c_cls)) {
-            return 2;
-        } else if (is_nan(b_cls)) {
-            return 1;
-        } else {
-            return 0;
-        }
-    }
 #else
-    /* A default implementation: prefer a to b to c.
-     * This is unlikely to actually match any real implementation.
-     */
-    if (is_nan(a_cls)) {
-        return 0;
-    } else if (is_nan(b_cls)) {
-        return 1;
-    } else {
-        return 2;
-    }
+        rule = float_3nan_prop_abc;
 #endif
+    }
+
+    assert(rule != float_3nan_prop_none);
+    if (have_snan && (rule & R_3NAN_SNAN_MASK)) {
+        /* We have at least one SNaN input and should prefer it */
+        do {
+            which = rule & R_3NAN_1ST_MASK;
+            rule >>= R_3NAN_1ST_LENGTH;
+        } while (!is_snan(cls[which]));
+    } else {
+        do {
+            which = rule & R_3NAN_1ST_MASK;
+            rule >>= R_3NAN_1ST_LENGTH;
+        } while (!is_nan(cls[which]));
+    }
+    return which;
 }
 
 /*----------------------------------------------------------------------------
-- 
2.34.1

Explicitly set a rule in the softfloat tests for propagating NaNs in
the muladd case.  In meson.build we put -DTARGET_ARM in fpcflags, and
so we should select here the Arm rule of float_3nan_prop_s_cab.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-17-peter.maydell@linaro.org
---
 tests/fp/fp-bench.c | 1 +
 tests/fp/fp-test.c  | 1 +
 2 files changed, 2 insertions(+)

diff --git a/tests/fp/fp-bench.c b/tests/fp/fp-bench.c
index XXXXXXX..XXXXXXX 100644
--- a/tests/fp/fp-bench.c
+++ b/tests/fp/fp-bench.c
@@ -XXX,XX +XXX,XX @@ static void run_bench(void)
      * doesn't specify match those used by the Arm architecture.
      */
     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &soft_status);
+    set_float_3nan_prop_rule(float_3nan_prop_s_cab, &soft_status);
     set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, &soft_status);
 
     f = bench_funcs[operation][precision];
diff --git a/tests/fp/fp-test.c b/tests/fp/fp-test.c
index XXXXXXX..XXXXXXX 100644
--- a/tests/fp/fp-test.c
+++ b/tests/fp/fp-test.c
@@ -XXX,XX +XXX,XX @@ void run_test(void)
      * doesn't specify match those used by the Arm architecture.
      */
     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &qsf);
+    set_float_3nan_prop_rule(float_3nan_prop_s_cab, &qsf);
     set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, &qsf);
 
     genCases_setLevel(test_level);
-- 
2.34.1

Set the Float3NaNPropRule explicitly for Arm, and remove the
ifdef from pickNaNMulAdd().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-18-peter.maydell@linaro.org
---
 target/arm/cpu.c               | 5 +++++
 fpu/softfloat-specialize.c.inc | 8 +-------
 2 files changed, 6 insertions(+), 7 deletions(-)

diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ void arm_register_el_change_hook(ARMCPU *cpu, ARMELChangeHookFn *hook,
  *  * tininess-before-rounding
  *  * 2-input NaN propagation prefers SNaN over QNaN, and then
  *    operand A over operand B (see FPProcessNaNs() pseudocode)
+ *  * 3-input NaN propagation prefers SNaN over QNaN, and then
+ *    operand C over A over B (see FPProcessNaNs3() pseudocode,
+ *    but note that for QEMU muladd is a * b + c, whereas for
+ *    the pseudocode function the arguments are in the order c, a, b.
  *  * 0 * Inf + NaN returns the default NaN if the input NaN is quiet,
  *    and the input NaN if it is signalling
  */
@@ -XXX,XX +XXX,XX @@ static void arm_set_default_fp_behaviours(float_status *s)
 {
     set_float_detect_tininess(float_tininess_before_rounding, s);
     set_float_2nan_prop_rule(float_2nan_prop_s_ab, s);
+    set_float_3nan_prop_rule(float_3nan_prop_s_cab, s);
     set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, s);
 }
 
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
     }
 
     if (rule == float_3nan_prop_none) {
-#if defined(TARGET_ARM)
-        /*
-         * This looks different from the ARM ARM pseudocode, because the ARM ARM
-         * puts the operands to a fused mac operation (a*b)+c in the order c,a,b
-         */
-        rule = float_3nan_prop_s_cab;
-#elif defined(TARGET_MIPS)
+#if defined(TARGET_MIPS)
         if (snan_bit_is_one(status)) {
             rule = float_3nan_prop_s_abc;
         } else {
-- 
2.34.1

Set the Float3NaNPropRule explicitly for loongarch, and remove the
ifdef from pickNaNMulAdd().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-19-peter.maydell@linaro.org
---
 target/loongarch/tcg/fpu_helper.c | 1 +
 fpu/softfloat-specialize.c.inc    | 2 --
 2 files changed, 1 insertion(+), 2 deletions(-)

diff --git a/target/loongarch/tcg/fpu_helper.c b/target/loongarch/tcg/fpu_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/loongarch/tcg/fpu_helper.c
+++ b/target/loongarch/tcg/fpu_helper.c
@@ -XXX,XX +XXX,XX @@ void restore_fp_status(CPULoongArchState *env)
      * case sets InvalidOp and returns the input value 'c'
      */
     set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
+    set_float_3nan_prop_rule(float_3nan_prop_s_cab, &env->fp_status);
 }
 
 int ieee_ex_to_loongarch(int xcpt)
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
         } else {
             rule = float_3nan_prop_s_cab;
         }
-#elif defined(TARGET_LOONGARCH64)
-        rule = float_3nan_prop_s_cab;
 #elif defined(TARGET_PPC)
         /*
          * If fRA is a NaN return it; otherwise if fRB is a NaN return it;
-- 
2.34.1

Set the Float3NaNPropRule explicitly for PPC, and remove the
ifdef from pickNaNMulAdd().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-20-peter.maydell@linaro.org
---
 target/ppc/cpu_init.c          | 8 ++++++++
 fpu/softfloat-specialize.c.inc | 6 ------
 2 files changed, 8 insertions(+), 6 deletions(-)

diff --git a/target/ppc/cpu_init.c b/target/ppc/cpu_init.c
index XXXXXXX..XXXXXXX 100644
--- a/target/ppc/cpu_init.c
+++ b/target/ppc/cpu_init.c
@@ -XXX,XX +XXX,XX @@ static void ppc_cpu_reset_hold(Object *obj, ResetType type)
      */
     set_float_2nan_prop_rule(float_2nan_prop_ab, &env->fp_status);
     set_float_2nan_prop_rule(float_2nan_prop_ab, &env->vec_status);
+    /*
+     * NaN propagation for fused multiply-add:
+     * if fRA is a NaN return it; otherwise if fRB is a NaN return it;
+     * otherwise return fRC. Note that muladd on PPC is (fRA * fRC) + frB
+     * whereas QEMU labels the operands as (a * b) + c.
+     */
+    set_float_3nan_prop_rule(float_3nan_prop_acb, &env->fp_status);
+    set_float_3nan_prop_rule(float_3nan_prop_acb, &env->vec_status);
     /*
      * For PPC, the (inf,zero,qnan) case sets InvalidOp, but we prefer
      * to return an input NaN if we have one (ie c) rather than generating
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
         } else {
             rule = float_3nan_prop_s_cab;
         }
-#elif defined(TARGET_PPC)
-        /*
-         * If fRA is a NaN return it; otherwise if fRB is a NaN return it;
-         * otherwise return fRC. Note that muladd on PPC is (fRA * fRC) + frB
-         */
-        rule = float_3nan_prop_acb;
 #elif defined(TARGET_S390X)
         rule = float_3nan_prop_s_abc;
 #elif defined(TARGET_SPARC)
-- 
2.34.1

Set the Float3NaNPropRule explicitly for s390x, and remove the
ifdef from pickNaNMulAdd().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-21-peter.maydell@linaro.org
---
 target/s390x/cpu.c             | 1 +
 fpu/softfloat-specialize.c.inc | 2 --
 2 files changed, 1 insertion(+), 2 deletions(-)

diff --git a/target/s390x/cpu.c b/target/s390x/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/s390x/cpu.c
+++ b/target/s390x/cpu.c
@@ -XXX,XX +XXX,XX @@ static void s390_cpu_reset_hold(Object *obj, ResetType type)
         set_float_detect_tininess(float_tininess_before_rounding,
                                   &env->fpu_status);
         set_float_2nan_prop_rule(float_2nan_prop_s_ab, &env->fpu_status);
+        set_float_3nan_prop_rule(float_3nan_prop_s_abc, &env->fpu_status);
         set_float_infzeronan_rule(float_infzeronan_dnan_always,
                                   &env->fpu_status);
        /* fall through */
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
         } else {
             rule = float_3nan_prop_s_cab;
         }
-#elif defined(TARGET_S390X)
-        rule = float_3nan_prop_s_abc;
 #elif defined(TARGET_SPARC)
         rule = float_3nan_prop_s_cba;
 #elif defined(TARGET_XTENSA)
-- 
2.34.1

Set the Float3NaNPropRule explicitly for SPARC, and remove the
ifdef from pickNaNMulAdd().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-22-peter.maydell@linaro.org
---
 target/sparc/cpu.c             | 2 ++
 fpu/softfloat-specialize.c.inc | 2 --
 2 files changed, 2 insertions(+), 2 deletions(-)

diff --git a/target/sparc/cpu.c b/target/sparc/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/sparc/cpu.c
+++ b/target/sparc/cpu.c
@@ -XXX,XX +XXX,XX @@ static void sparc_cpu_realizefn(DeviceState *dev, Error **errp)
      * the CPU state struct so it won't get zeroed on reset.
      */
     set_float_2nan_prop_rule(float_2nan_prop_s_ba, &env->fp_status);
+    /* For fused-multiply add, prefer SNaN over QNaN, then C->B->A */
+    set_float_3nan_prop_rule(float_3nan_prop_s_cba, &env->fp_status);
     /* For inf * 0 + NaN, return the input NaN */
     set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
 
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
         } else {
             rule = float_3nan_prop_s_cab;
         }
-#elif defined(TARGET_SPARC)
-        rule = float_3nan_prop_s_cba;
 #elif defined(TARGET_XTENSA)
         if (status->use_first_nan) {
             rule = float_3nan_prop_abc;
-- 
2.34.1

Set the Float3NaNPropRule explicitly for Arm, and remove the
ifdef from pickNaNMulAdd().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-23-peter.maydell@linaro.org
---
 target/mips/fpu_helper.h       | 4 ++++
 target/mips/msa.c              | 3 +++
 fpu/softfloat-specialize.c.inc | 8 +-------
 3 files changed, 8 insertions(+), 7 deletions(-)

diff --git a/target/mips/fpu_helper.h b/target/mips/fpu_helper.h
index XXXXXXX..XXXXXXX 100644
--- a/target/mips/fpu_helper.h
+++ b/target/mips/fpu_helper.h
@@ -XXX,XX +XXX,XX @@ static inline void restore_snan_bit_mode(CPUMIPSState *env)
 {
     bool nan2008 = env->active_fpu.fcr31 & (1 << FCR31_NAN2008);
     FloatInfZeroNaNRule izn_rule;
+    Float3NaNPropRule nan3_rule;
 
     /*
      * With nan2008, SNaNs are silenced in the usual way.
@@ -XXX,XX +XXX,XX @@ static inline void restore_snan_bit_mode(CPUMIPSState *env)
      */
     izn_rule = nan2008 ? float_infzeronan_dnan_never : float_infzeronan_dnan_always;
     set_float_infzeronan_rule(izn_rule, &env->active_fpu.fp_status);
+    nan3_rule = nan2008 ? float_3nan_prop_s_cab : float_3nan_prop_s_abc;
+    set_float_3nan_prop_rule(nan3_rule, &env->active_fpu.fp_status);
+
 }
 
 static inline void restore_fp_status(CPUMIPSState *env)
diff --git a/target/mips/msa.c b/target/mips/msa.c
index XXXXXXX..XXXXXXX 100644
--- a/target/mips/msa.c
+++ b/target/mips/msa.c
@@ -XXX,XX +XXX,XX @@ void msa_reset(CPUMIPSState *env)
     set_float_2nan_prop_rule(float_2nan_prop_s_ab,
                              &env->active_tc.msa_fp_status);
 
+    set_float_3nan_prop_rule(float_3nan_prop_s_cab,
+                             &env->active_tc.msa_fp_status);
+
     /* clear float_status exception flags */
     set_float_exception_flags(0, &env->active_tc.msa_fp_status);
 
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
     }
 
     if (rule == float_3nan_prop_none) {
-#if defined(TARGET_MIPS)
-        if (snan_bit_is_one(status)) {
-            rule = float_3nan_prop_s_abc;
-        } else {
-            rule = float_3nan_prop_s_cab;
-        }
-#elif defined(TARGET_XTENSA)
+#if defined(TARGET_XTENSA)
         if (status->use_first_nan) {
             rule = float_3nan_prop_abc;
         } else {
-- 
2.34.1

Set the Float3NaNPropRule explicitly for xtensa, and remove the
ifdef from pickNaNMulAdd().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-24-peter.maydell@linaro.org
---
 target/xtensa/fpu_helper.c     | 2 ++
 fpu/softfloat-specialize.c.inc | 8 --------
 2 files changed, 2 insertions(+), 8 deletions(-)

diff --git a/target/xtensa/fpu_helper.c b/target/xtensa/fpu_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/xtensa/fpu_helper.c
+++ b/target/xtensa/fpu_helper.c
@@ -XXX,XX +XXX,XX @@ void xtensa_use_first_nan(CPUXtensaState *env, bool use_first)
     set_use_first_nan(use_first, &env->fp_status);
     set_float_2nan_prop_rule(use_first ? float_2nan_prop_ab : float_2nan_prop_ba,
                              &env->fp_status);
+    set_float_3nan_prop_rule(use_first ? float_3nan_prop_abc : float_3nan_prop_cba,
+                             &env->fp_status);
 }
 
 void HELPER(wur_fpu2k_fcr)(CPUXtensaState *env, uint32_t v)
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
     }
 
     if (rule == float_3nan_prop_none) {
-#if defined(TARGET_XTENSA)
-        if (status->use_first_nan) {
-            rule = float_3nan_prop_abc;
-        } else {
-            rule = float_3nan_prop_cba;
-        }
-#else
         rule = float_3nan_prop_abc;
-#endif
     }
 
     assert(rule != float_3nan_prop_none);
-- 
2.34.1

Set the Float3NaNPropRule explicitly for i386.  We had no
i386-specific behaviour in the old ifdef ladder, so we were using the
default "prefer a then b then c" fallback; this is actually the
correct per-the-spec handling for i386.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-25-peter.maydell@linaro.org
---
 target/i386/tcg/fpu_helper.c | 1 +
 1 file changed, 1 insertion(+)

Set the Float3NaNPropRule explicitly for HPPA, and remove the
ifdef from pickNaNMulAdd().

HPPA is the only target that was using the default branch of the
ifdef ladder (other targets either do not use muladd or set
default_nan_mode), so we can remove the ifdef fallback entirely now
(allowing the "rule not set" case to fall into the default of the
switch statement and assert).

We add a TODO note that the HPPA rule is probably wrong; this is
not a behavioural change for this refactoring.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-26-peter.maydell@linaro.org
---
 target/hppa/fpu_helper.c       | 8 ++++++++
 fpu/softfloat-specialize.c.inc | 4 ----
 2 files changed, 8 insertions(+), 4 deletions(-)

diff --git a/target/hppa/fpu_helper.c b/target/hppa/fpu_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/hppa/fpu_helper.c
+++ b/target/hppa/fpu_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(loaded_fr0)(CPUHPPAState *env)
      * HPPA does note implement a CPU reset method at all...
      */
     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &env->fp_status);
+    /*
+     * TODO: The HPPA architecture reference only documents its NaN
+     * propagation rule for 2-operand operations. Testing on real hardware
+     * might be necessary to confirm whether this order for muladd is correct.
+     * Not preferring the SNaN is almost certainly incorrect as it diverges
+     * from the documented rules for 2-operand operations.
+     */
+    set_float_3nan_prop_rule(float_3nan_prop_abc, &env->fp_status);
     /* For inf * 0 + NaN, return the input NaN */
     set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
 }
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
         }
     }
 
-    if (rule == float_3nan_prop_none) {
-        rule = float_3nan_prop_abc;
-    }
-
     assert(rule != float_3nan_prop_none);
     if (have_snan && (rule & R_3NAN_SNAN_MASK)) {
         /* We have at least one SNaN input and should prefer it */
-- 
2.34.1

The use_first_nan field in float_status was an xtensa-specific way to
select at runtime from two different NaN propagation rules.  Now that
xtensa is using the target-agnostic NaN propagation rule selection
that we've just added, we can remove use_first_nan, because there is
no longer any code that reads it.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-27-peter.maydell@linaro.org
---
 include/fpu/softfloat-helpers.h | 5 -----
 include/fpu/softfloat-types.h   | 1 -
 target/xtensa/fpu_helper.c      | 1 -
 3 files changed, 7 deletions(-)

Currently m68k_cpu_reset_hold() calls floatx80_default_nan(NULL)
to get the NaN bit pattern to reset the FPU registers. This
works because it happens that our implementation of
floatx80_default_nan() doesn't actually look at the float_status
pointer except for TARGET_MIPS. However, this isn't guaranteed,
and to be able to remove the ifdef in floatx80_default_nan()
we're going to need a real float_status here.

Rearrange m68k_cpu_reset_hold() so that we initialize env->fp_status
earlier, and thus can pass it to floatx80_default_nan().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-28-peter.maydell@linaro.org
---
 target/m68k/cpu.c | 12 +++++++-----
 1 file changed, 7 insertions(+), 5 deletions(-)

diff --git a/target/m68k/cpu.c b/target/m68k/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/m68k/cpu.c
+++ b/target/m68k/cpu.c
@@ -XXX,XX +XXX,XX @@ static void m68k_cpu_reset_hold(Object *obj, ResetType type)
     CPUState *cs = CPU(obj);
     M68kCPUClass *mcc = M68K_CPU_GET_CLASS(obj);
     CPUM68KState *env = cpu_env(cs);
-    floatx80 nan = floatx80_default_nan(NULL);
+    floatx80 nan;
     int i;
 
     if (mcc->parent_phases.hold) {
@@ -XXX,XX +XXX,XX @@ static void m68k_cpu_reset_hold(Object *obj, ResetType type)
 #else
     cpu_m68k_set_sr(env, SR_S | SR_I);
 #endif
-    for (i = 0; i < 8; i++) {
-        env->fregs[i].d = nan;
-    }
-    cpu_m68k_set_fpcr(env, 0);
     /*
      * M68000 FAMILY PROGRAMMER'S REFERENCE MANUAL
      * 3.4 FLOATING-POINT INSTRUCTION DETAILS
@@ -XXX,XX +XXX,XX @@ static void m68k_cpu_reset_hold(Object *obj, ResetType type)
      * preceding paragraph for nonsignaling NaNs.
      */
     set_float_2nan_prop_rule(float_2nan_prop_ab, &env->fp_status);
+
+    nan = floatx80_default_nan(&env->fp_status);
+    for (i = 0; i < 8; i++) {
+        env->fregs[i].d = nan;
+    }
+    cpu_m68k_set_fpcr(env, 0);
     env->fpsr = 0;
 
     /* TODO: We should set PC from the interrupt vector.  */
-- 
2.34.1

We create our 128-bit default NaN by calling parts64_default_nan()
and then adjusting the result.  We can do the same trick for creating
the floatx80 default NaN, which lets us drop a target ifdef.

floatx80 is used only by:
 i386
 m68k
 arm nwfpe old floating-point emulation emulation support
    (which is essentially dead, especially the parts involving floatx80)
 PPC (only in the xsrqpxp instruction, which just rounds an input
    value by converting to floatx80 and back, so will never generate
    the default NaN)

The floatx80 default NaN as currently implemented is:
 m68k: sign = 0, exp = 1...1, int = 1, frac = 1....1
 i386: sign = 1, exp = 1...1, int = 1, frac = 10...0

These are the same as the parts64_default_nan for these architectures.

This is technically a possible behaviour change for arm linux-user
nwfpe emulation emulation, because the default NaN will now have the
sign bit clear.  But we were already generating a different floatx80
default NaN from the real kernel emulation we are supposedly
following, which appears to use an all-bits-1 value:
 https://elixir.bootlin.com/linux/v6.12/source/arch/arm/nwfpe/softfloat-specialize#L267

This won't affect the only "real" use of the nwfpe emulation, which
is ancient binaries that used it as part of the old floating point
calling convention; that only uses loads and stores of 32 and 64 bit
floats, not any of the floatx80 behaviour the original hardware had.
We also get the nwfpe float64 default NaN value wrong:
 https://elixir.bootlin.com/linux/v6.12/source/arch/arm/nwfpe/softfloat-specialize#L166
so if we ever cared about this obscure corner the right fix would be
to correct that so nwfpe used its own default-NaN setting rather
than the Arm VFP one.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-29-peter.maydell@linaro.org
---
 fpu/softfloat-specialize.c.inc | 20 ++++++++++----------
 1 file changed, 10 insertions(+), 10 deletions(-)

diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static void parts128_silence_nan(FloatParts128 *p, float_status *status)
 floatx80 floatx80_default_nan(float_status *status)
 {
     floatx80 r;
+    /*
+     * Extrapolate from the choices made by parts64_default_nan to fill
+     * in the floatx80 format. We assume that floatx80's explicit
+     * integer bit is always set (this is true for i386 and m68k,
+     * which are the only real users of this format).
+     */
+    FloatParts64 p64;
+    parts64_default_nan(&p64, status);
 
-    /* None of the targets that have snan_bit_is_one use floatx80.  */
-    assert(!snan_bit_is_one(status));
-#if defined(TARGET_M68K)
-    r.low = UINT64_C(0xFFFFFFFFFFFFFFFF);
-    r.high = 0x7FFF;
-#else
-    /* X86 */
-    r.low = UINT64_C(0xC000000000000000);
-    r.high = 0xFFFF;
-#endif
+    r.high = 0x7FFF | (p64.sign << 15);
+    r.low = (1ULL << DECOMPOSED_BINARY_POINT) | p64.frac;
     return r;
 }
 
-- 
2.34.1

In target/loongarch's helper_fclass_s() and helper_fclass_d() we pass
a zero-initialized float_status struct to float32_is_quiet_nan() and
float64_is_quiet_nan(), with the cryptic comment "for
snan_bit_is_one".

This pattern appears to have been copied from target/riscv, where it
is used because the functions there do not have ready access to the
CPU state struct. The comment presumably refers to the fact that the
main reason the is_quiet_nan() functions want the float_state is
because they want to know about the snan_bit_is_one config.

In the loongarch helpers, though, we have the CPU state struct
to hand. Use the usual env->fp_status here. This avoids our needing
to track that we need to update the initializer of the local
float_status structs when the core softfloat code adds new
options for targets to configure their behaviour.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-30-peter.maydell@linaro.org
---
 target/loongarch/tcg/fpu_helper.c | 6 ++----
 1 file changed, 2 insertions(+), 4 deletions(-)

diff --git a/target/loongarch/tcg/fpu_helper.c b/target/loongarch/tcg/fpu_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/loongarch/tcg/fpu_helper.c
+++ b/target/loongarch/tcg/fpu_helper.c
@@ -XXX,XX +XXX,XX @@ uint64_t helper_fclass_s(CPULoongArchState *env, uint64_t fj)
     } else if (float32_is_zero_or_denormal(f)) {
         return sign ? 1 << 4 : 1 << 8;
     } else if (float32_is_any_nan(f)) {
-        float_status s = { }; /* for snan_bit_is_one */
-        return float32_is_quiet_nan(f, &s) ? 1 << 1 : 1 << 0;
+        return float32_is_quiet_nan(f, &env->fp_status) ? 1 << 1 : 1 << 0;
     } else {
         return sign ? 1 << 3 : 1 << 7;
     }
@@ -XXX,XX +XXX,XX @@ uint64_t helper_fclass_d(CPULoongArchState *env, uint64_t fj)
     } else if (float64_is_zero_or_denormal(f)) {
         return sign ? 1 << 4 : 1 << 8;
     } else if (float64_is_any_nan(f)) {
-        float_status s = { }; /* for snan_bit_is_one */
-        return float64_is_quiet_nan(f, &s) ? 1 << 1 : 1 << 0;
+        return float64_is_quiet_nan(f, &env->fp_status) ? 1 << 1 : 1 << 0;
     } else {
         return sign ? 1 << 3 : 1 << 7;
     }
-- 
2.34.1

In the frem helper, we have a local float_status because we want to
execute the floatx80_div() with a custom rounding mode.  Instead of
zero-initializing the local float_status and then having to set it up
with the m68k standard behaviour (including the NaN propagation rule
and copying the rounding precision from env->fp_status), initialize
it as a complete copy of env->fp_status. This will avoid our having
to add new code in this function for every new config knob we add
to fp_status.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-31-peter.maydell@linaro.org
---
 target/m68k/fpu_helper.c | 6 ++----
 1 file changed, 2 insertions(+), 4 deletions(-)

diff --git a/target/m68k/fpu_helper.c b/target/m68k/fpu_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/m68k/fpu_helper.c
+++ b/target/m68k/fpu_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(frem)(CPUM68KState *env, FPReg *res, FPReg *val0, FPReg *val1)
 
     fp_rem = floatx80_rem(val1->d, val0->d, &env->fp_status);
     if (!floatx80_is_any_nan(fp_rem)) {
-        float_status fp_status = { };
+        /* Use local temporary fp_status to set different rounding mode */
+        float_status fp_status = env->fp_status;
         uint32_t quotient;
         int sign;
 
         /* Calculate quotient directly using round to nearest mode */
-        set_float_2nan_prop_rule(float_2nan_prop_ab, &fp_status);
         set_float_rounding_mode(float_round_nearest_even, &fp_status);
-        set_floatx80_rounding_precision(
-            get_floatx80_rounding_precision(&env->fp_status), &fp_status);
         fp_quot.d = floatx80_div(val1->d, val0->d, &fp_status);
 
         sign = extractFloatx80Sign(fp_quot.d);
-- 
2.34.1

In cf_fpu_gdb_get_reg() and cf_fpu_gdb_set_reg() we do the conversion
from float64 to floatx80 using a scratch float_status, because we
don't want the conversion to affect the CPU's floating point exception
status. Currently we use a zero-initialized float_status. This will
get steadily more awkward as we add config knobs to float_status
that the target must initialize. Avoid having to add any of that
configuration here by instead initializing our local float_status
from the env->fp_status.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-32-peter.maydell@linaro.org
---
 target/m68k/helper.c | 6 ++++--
 1 file changed, 4 insertions(+), 2 deletions(-)

diff --git a/target/m68k/helper.c b/target/m68k/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/m68k/helper.c
+++ b/target/m68k/helper.c
@@ -XXX,XX +XXX,XX @@ static int cf_fpu_gdb_get_reg(CPUState *cs, GByteArray *mem_buf, int n)
     CPUM68KState *env = &cpu->env;
 
     if (n < 8) {
-        float_status s = {};
+        /* Use scratch float_status so any exceptions don't change CPU state */
+        float_status s = env->fp_status;
         return gdb_get_reg64(mem_buf, floatx80_to_float64(env->fregs[n].d, &s));
     }
     switch (n) {
@@ -XXX,XX +XXX,XX @@ static int cf_fpu_gdb_set_reg(CPUState *cs, uint8_t *mem_buf, int n)
     CPUM68KState *env = &cpu->env;
 
     if (n < 8) {
-        float_status s = {};
+        /* Use scratch float_status so any exceptions don't change CPU state */
+        float_status s = env->fp_status;
         env->fregs[n].d = float64_to_floatx80(ldq_be_p(mem_buf), &s);
         return 8;
     }
-- 
2.34.1

In the helper functions flcmps and flcmpd we use a scratch float_status
so that we don't change the CPU state if the comparison raises any
floating point exception flags. Instead of zero-initializing this
scratch float_status, initialize it as a copy of env->fp_status. This
avoids the need to explicitly initialize settings like the NaN
propagation rule or others we might add to softfloat in future.

To do this we need to pass the CPU env pointer in to the helper.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-33-peter.maydell@linaro.org
---
 target/sparc/helper.h     | 4 ++--
 target/sparc/fop_helper.c | 8 ++++----
 target/sparc/translate.c  | 4 ++--
 3 files changed, 8 insertions(+), 8 deletions(-)

diff --git a/target/sparc/helper.h b/target/sparc/helper.h
index XXXXXXX..XXXXXXX 100644
--- a/target/sparc/helper.h
+++ b/target/sparc/helper.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_3(fcmpd, TCG_CALL_NO_WG, i32, env, f64, f64)
 DEF_HELPER_FLAGS_3(fcmped, TCG_CALL_NO_WG, i32, env, f64, f64)
 DEF_HELPER_FLAGS_3(fcmpq, TCG_CALL_NO_WG, i32, env, i128, i128)
 DEF_HELPER_FLAGS_3(fcmpeq, TCG_CALL_NO_WG, i32, env, i128, i128)
-DEF_HELPER_FLAGS_2(flcmps, TCG_CALL_NO_RWG_SE, i32, f32, f32)
-DEF_HELPER_FLAGS_2(flcmpd, TCG_CALL_NO_RWG_SE, i32, f64, f64)
+DEF_HELPER_FLAGS_3(flcmps, TCG_CALL_NO_RWG_SE, i32, env, f32, f32)
+DEF_HELPER_FLAGS_3(flcmpd, TCG_CALL_NO_RWG_SE, i32, env, f64, f64)
 DEF_HELPER_2(raise_exception, noreturn, env, int)
 
 DEF_HELPER_FLAGS_3(faddd, TCG_CALL_NO_WG, f64, env, f64, f64)
diff --git a/target/sparc/fop_helper.c b/target/sparc/fop_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/sparc/fop_helper.c
+++ b/target/sparc/fop_helper.c
@@ -XXX,XX +XXX,XX @@ uint32_t helper_fcmpeq(CPUSPARCState *env, Int128 src1, Int128 src2)
     return finish_fcmp(env, r, GETPC());
 }
 
-uint32_t helper_flcmps(float32 src1, float32 src2)
+uint32_t helper_flcmps(CPUSPARCState *env, float32 src1, float32 src2)
 {
     /*
      * FLCMP never raises an exception nor modifies any FSR fields.
      * Perform the comparison with a dummy fp environment.
      */
-    float_status discard = { };
+    float_status discard = env->fp_status;
     FloatRelation r;
 
     set_float_2nan_prop_rule(float_2nan_prop_s_ba, &discard);
@@ -XXX,XX +XXX,XX @@ uint32_t helper_flcmps(float32 src1, float32 src2)
     g_assert_not_reached();
 }
 
-uint32_t helper_flcmpd(float64 src1, float64 src2)
+uint32_t helper_flcmpd(CPUSPARCState *env, float64 src1, float64 src2)
 {
-    float_status discard = { };
+    float_status discard = env->fp_status;
     FloatRelation r;
 
     set_float_2nan_prop_rule(float_2nan_prop_s_ba, &discard);
diff --git a/target/sparc/translate.c b/target/sparc/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/sparc/translate.c
+++ b/target/sparc/translate.c
@@ -XXX,XX +XXX,XX @@ static bool trans_FLCMPs(DisasContext *dc, arg_FLCMPs *a)
 
     src1 = gen_load_fpr_F(dc, a->rs1);
     src2 = gen_load_fpr_F(dc, a->rs2);
-    gen_helper_flcmps(cpu_fcc[a->cc], src1, src2);
+    gen_helper_flcmps(cpu_fcc[a->cc], tcg_env, src1, src2);
     return advance_pc(dc);
 }
 
@@ -XXX,XX +XXX,XX @@ static bool trans_FLCMPd(DisasContext *dc, arg_FLCMPd *a)
 
     src1 = gen_load_fpr_D(dc, a->rs1);
     src2 = gen_load_fpr_D(dc, a->rs2);
-    gen_helper_flcmpd(cpu_fcc[a->cc], src1, src2);
+    gen_helper_flcmpd(cpu_fcc[a->cc], tcg_env, src1, src2);
     return advance_pc(dc);
 }
 
-- 
2.34.1

In the helper_compute_fprf functions, we pass a dummy float_status
in to the is_signaling_nan() function. This is unnecessary, because
we have convenient access to the CPU env pointer here and that
is already set up with the correct values for the snan_bit_is_one
and no_signaling_nans config settings. is_signaling_nan() doesn't
ever update the fp_status with any exception flags, so there is
no reason not to use env->fp_status here.

Use env->fp_status instead of the dummy fp_status.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-34-peter.maydell@linaro.org
---
 target/ppc/fpu_helper.c | 3 +--
 1 file changed, 1 insertion(+), 2 deletions(-)

diff --git a/target/ppc/fpu_helper.c b/target/ppc/fpu_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/ppc/fpu_helper.c
+++ b/target/ppc/fpu_helper.c
@@ -XXX,XX +XXX,XX @@ void helper_compute_fprf_##tp(CPUPPCState *env, tp arg)           \
     } else if (tp##_is_infinity(arg)) {                           \
         fprf = neg ? 0x09 << FPSCR_FPRF : 0x05 << FPSCR_FPRF;     \
     } else {                                                      \
-        float_status dummy = { };  /* snan_bit_is_one = 0 */      \
-        if (tp##_is_signaling_nan(arg, &dummy)) {                 \
+        if (tp##_is_signaling_nan(arg, &env->fp_status)) {        \
             fprf = 0x00 << FPSCR_FPRF;                            \
         } else {                                                  \
             fprf = 0x11 << FPSCR_FPRF;                            \
-- 
2.34.1

From: Richard Henderson <richard.henderson@linaro.org>

Now that float_status has a bunch of fp parameters,
it is easier to copy an existing structure than create
one from scratch.  Begin by copying the structure that
corresponds to the FPSR and make only the adjustments
required for BFloat16 semantics.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <philmd@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20241203203949.483774-2-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/tcg/vec_helper.c | 20 +++++++-------------
 1 file changed, 7 insertions(+), 13 deletions(-)

diff --git a/target/arm/tcg/vec_helper.c b/target/arm/tcg/vec_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/tcg/vec_helper.c
+++ b/target/arm/tcg/vec_helper.c
@@ -XXX,XX +XXX,XX @@ bool is_ebf(CPUARMState *env, float_status *statusp, float_status *oddstatusp)
      * no effect on AArch32 instructions.
      */
     bool ebf = is_a64(env) && env->vfp.fpcr & FPCR_EBF;
-    *statusp = (float_status){
-        .tininess_before_rounding = float_tininess_before_rounding,
-        .float_rounding_mode = float_round_to_odd_inf,
-        .flush_to_zero = true,
-        .flush_inputs_to_zero = true,
-        .default_nan_mode = true,
-    };
+
+    *statusp = env->vfp.fp_status;
+    set_default_nan_mode(true, statusp);
 
     if (ebf) {
-        float_status *fpst = &env->vfp.fp_status;
-        set_flush_to_zero(get_flush_to_zero(fpst), statusp);
-        set_flush_inputs_to_zero(get_flush_inputs_to_zero(fpst), statusp);
-        set_float_rounding_mode(get_float_rounding_mode(fpst), statusp);
-
         /* EBF=1 needs to do a step with round-to-odd semantics */
         *oddstatusp = *statusp;
         set_float_rounding_mode(float_round_to_odd, oddstatusp);
+    } else {
+        set_flush_to_zero(true, statusp);
+        set_flush_inputs_to_zero(true, statusp);
+        set_float_rounding_mode(float_round_to_odd_inf, statusp);
     }
-
     return ebf;
 }
 
-- 
2.34.1

Currently we hardcode the default NaN value in parts64_default_nan()
using a compile-time ifdef ladder. This is awkward for two cases:
 * for single-QEMU-binary we can't hard-code target-specifics like this
 * for Arm FEAT_AFP the default NaN value depends on FPCR.AH
   (specifically the sign bit is different)

Add a field to float_status to specify the default NaN value; fall
back to the old ifdef behaviour if these are not set.

The default NaN value is specified by setting a uint8_t to a
pattern corresponding to the sign and upper fraction parts of
the NaN; the lower bits of the fraction are set from bit 0 of
the pattern.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-35-peter.maydell@linaro.org
---
 include/fpu/softfloat-helpers.h | 11 +++++++
 include/fpu/softfloat-types.h   | 10 ++++++
 fpu/softfloat-specialize.c.inc  | 55 ++++++++++++++++++++-------------
 3 files changed, 54 insertions(+), 22 deletions(-)

Set the default NaN pattern explicitly for the tests/fp code.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-36-peter.maydell@linaro.org
---
 tests/fp/fp-bench.c     | 1 +
 tests/fp/fp-test-log2.c | 1 +
 tests/fp/fp-test.c      | 1 +
 3 files changed, 3 insertions(+)

diff --git a/tests/fp/fp-bench.c b/tests/fp/fp-bench.c
index XXXXXXX..XXXXXXX 100644
--- a/tests/fp/fp-bench.c
+++ b/tests/fp/fp-bench.c
@@ -XXX,XX +XXX,XX @@ static void run_bench(void)
     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &soft_status);
     set_float_3nan_prop_rule(float_3nan_prop_s_cab, &soft_status);
     set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, &soft_status);
+    set_float_default_nan_pattern(0b01000000, &soft_status);
 
     f = bench_funcs[operation][precision];
     g_assert(f);
diff --git a/tests/fp/fp-test-log2.c b/tests/fp/fp-test-log2.c
index XXXXXXX..XXXXXXX 100644
--- a/tests/fp/fp-test-log2.c
+++ b/tests/fp/fp-test-log2.c
@@ -XXX,XX +XXX,XX @@ int main(int ac, char **av)
     int i;
 
     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &qsf);
+    set_float_default_nan_pattern(0b01000000, &qsf);
     set_float_rounding_mode(float_round_nearest_even, &qsf);
 
     test.d = 0.0;
diff --git a/tests/fp/fp-test.c b/tests/fp/fp-test.c
index XXXXXXX..XXXXXXX 100644
--- a/tests/fp/fp-test.c
+++ b/tests/fp/fp-test.c
@@ -XXX,XX +XXX,XX @@ void run_test(void)
      */
     set_float_2nan_prop_rule(float_2nan_prop_s_ab, &qsf);
     set_float_3nan_prop_rule(float_3nan_prop_s_cab, &qsf);
+    set_float_default_nan_pattern(0b01000000, &qsf);
     set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, &qsf);
 
     genCases_setLevel(test_level);
-- 
2.34.1

Set the default NaN pattern explicitly, and remove the ifdef from
parts64_default_nan().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-37-peter.maydell@linaro.org
---
 target/microblaze/cpu.c        | 2 ++
 fpu/softfloat-specialize.c.inc | 3 +--
 2 files changed, 3 insertions(+), 2 deletions(-)

diff --git a/target/microblaze/cpu.c b/target/microblaze/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/microblaze/cpu.c
+++ b/target/microblaze/cpu.c
@@ -XXX,XX +XXX,XX @@ static void mb_cpu_reset_hold(Object *obj, ResetType type)
      * this architecture.
      */
     set_float_2nan_prop_rule(float_2nan_prop_x87, &env->fp_status);
+    /* Default NaN: sign bit set, most significant frac bit set */
+    set_float_default_nan_pattern(0b11000000, &env->fp_status);
 
 #if defined(CONFIG_USER_ONLY)
     /* start in user mode with interrupts enabled.  */
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static void parts64_default_nan(FloatParts64 *p, float_status *status)
 #if defined(TARGET_SPARC) || defined(TARGET_M68K)
         /* Sign bit clear, all frac bits set */
         dnan_pattern = 0b01111111;
-#elif defined(TARGET_I386) || defined(TARGET_X86_64)    \
-    || defined(TARGET_MICROBLAZE)
+#elif defined(TARGET_I386) || defined(TARGET_X86_64)
         /* Sign bit set, most significant frac bit set */
         dnan_pattern = 0b11000000;
 #elif defined(TARGET_HPPA)
-- 
2.34.1

Set the default NaN pattern explicitly, and remove the ifdef from
parts64_default_nan().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-38-peter.maydell@linaro.org
---
 target/i386/tcg/fpu_helper.c   | 4 ++++
 fpu/softfloat-specialize.c.inc | 3 ---
 2 files changed, 4 insertions(+), 3 deletions(-)

diff --git a/target/i386/tcg/fpu_helper.c b/target/i386/tcg/fpu_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/i386/tcg/fpu_helper.c
+++ b/target/i386/tcg/fpu_helper.c
@@ -XXX,XX +XXX,XX @@ void cpu_init_fp_statuses(CPUX86State *env)
      */
     set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->sse_status);
     set_float_3nan_prop_rule(float_3nan_prop_abc, &env->sse_status);
+    /* Default NaN: sign bit set, most significant frac bit set */
+    set_float_default_nan_pattern(0b11000000, &env->fp_status);
+    set_float_default_nan_pattern(0b11000000, &env->mmx_status);
+    set_float_default_nan_pattern(0b11000000, &env->sse_status);
 }
 
 static inline uint8_t save_exception_flags(CPUX86State *env)
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static void parts64_default_nan(FloatParts64 *p, float_status *status)
 #if defined(TARGET_SPARC) || defined(TARGET_M68K)
         /* Sign bit clear, all frac bits set */
         dnan_pattern = 0b01111111;
-#elif defined(TARGET_I386) || defined(TARGET_X86_64)
-        /* Sign bit set, most significant frac bit set */
-        dnan_pattern = 0b11000000;
 #elif defined(TARGET_HPPA)
         /* Sign bit clear, msb-1 frac bit set */
         dnan_pattern = 0b00100000;
-- 
2.34.1

Set the default NaN pattern explicitly, and remove the ifdef from
parts64_default_nan().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-39-peter.maydell@linaro.org
---
 target/hppa/fpu_helper.c       | 2 ++
 fpu/softfloat-specialize.c.inc | 3 ---
 2 files changed, 2 insertions(+), 3 deletions(-)

diff --git a/target/hppa/fpu_helper.c b/target/hppa/fpu_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/hppa/fpu_helper.c
+++ b/target/hppa/fpu_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(loaded_fr0)(CPUHPPAState *env)
     set_float_3nan_prop_rule(float_3nan_prop_abc, &env->fp_status);
     /* For inf * 0 + NaN, return the input NaN */
     set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
+    /* Default NaN: sign bit clear, msb-1 frac bit set */
+    set_float_default_nan_pattern(0b00100000, &env->fp_status);
 }
 
 void cpu_hppa_loaded_fr0(CPUHPPAState *env)
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static void parts64_default_nan(FloatParts64 *p, float_status *status)
 #if defined(TARGET_SPARC) || defined(TARGET_M68K)
         /* Sign bit clear, all frac bits set */
         dnan_pattern = 0b01111111;
-#elif defined(TARGET_HPPA)
-        /* Sign bit clear, msb-1 frac bit set */
-        dnan_pattern = 0b00100000;
 #elif defined(TARGET_HEXAGON)
         /* Sign bit set, all frac bits set. */
         dnan_pattern = 0b11111111;
-- 
2.34.1

Set the default NaN pattern explicitly for the arm target.
This includes setting it for the old linux-user nwfpe emulation.
For nwfpe, our default doesn't match the real kernel, but we
avoid making a behaviour change in this commit.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-41-peter.maydell@linaro.org
---
 linux-user/arm/nwfpe/fpa11.c | 5 +++++
 target/arm/cpu.c             | 2 ++
 2 files changed, 7 insertions(+)

diff --git a/linux-user/arm/nwfpe/fpa11.c b/linux-user/arm/nwfpe/fpa11.c
index XXXXXXX..XXXXXXX 100644
--- a/linux-user/arm/nwfpe/fpa11.c
+++ b/linux-user/arm/nwfpe/fpa11.c
@@ -XXX,XX +XXX,XX @@ void resetFPA11(void)
    * this late date.
    */
   set_float_2nan_prop_rule(float_2nan_prop_s_ab, &fpa11->fp_status);
+  /*
+   * Use the same default NaN value as Arm VFP. This doesn't match
+   * the Linux kernel's nwfpe emulation, which uses an all-1s value.
+   */
+  set_float_default_nan_pattern(0b01000000, &fpa11->fp_status);
 }
 
 void SetRoundingMode(const unsigned int opcode)
diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ void arm_register_el_change_hook(ARMCPU *cpu, ARMELChangeHookFn *hook,
  *    the pseudocode function the arguments are in the order c, a, b.
  *  * 0 * Inf + NaN returns the default NaN if the input NaN is quiet,
  *    and the input NaN if it is signalling
+ *  * Default NaN has sign bit clear, msb frac bit set
  */
 static void arm_set_default_fp_behaviours(float_status *s)
 {
@@ -XXX,XX +XXX,XX @@ static void arm_set_default_fp_behaviours(float_status *s)
     set_float_2nan_prop_rule(float_2nan_prop_s_ab, s);
     set_float_3nan_prop_rule(float_3nan_prop_s_cab, s);
     set_float_infzeronan_rule(float_infzeronan_dnan_if_qnan, s);
+    set_float_default_nan_pattern(0b01000000, s);
 }
 
 static void cp_reg_reset(gpointer key, gpointer value, gpointer opaque)
-- 
2.34.1

Set the default NaN pattern explicitly for m68k.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-43-peter.maydell@linaro.org
---
 target/m68k/cpu.c              | 2 ++
 fpu/softfloat-specialize.c.inc | 2 +-
 2 files changed, 3 insertions(+), 1 deletion(-)

diff --git a/target/m68k/cpu.c b/target/m68k/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/m68k/cpu.c
+++ b/target/m68k/cpu.c
@@ -XXX,XX +XXX,XX @@ static void m68k_cpu_reset_hold(Object *obj, ResetType type)
      * preceding paragraph for nonsignaling NaNs.
      */
     set_float_2nan_prop_rule(float_2nan_prop_ab, &env->fp_status);
+    /* Default NaN: sign bit clear, all frac bits set */
+    set_float_default_nan_pattern(0b01111111, &env->fp_status);
 
     nan = floatx80_default_nan(&env->fp_status);
     for (i = 0; i < 8; i++) {
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static void parts64_default_nan(FloatParts64 *p, float_status *status)
     uint8_t dnan_pattern = status->default_nan_pattern;
 
     if (dnan_pattern == 0) {
-#if defined(TARGET_SPARC) || defined(TARGET_M68K)
+#if defined(TARGET_SPARC)
         /* Sign bit clear, all frac bits set */
         dnan_pattern = 0b01111111;
 #elif defined(TARGET_HEXAGON)
-- 
2.34.1

Set the default NaN pattern explicitly for MIPS. Note that this
is our only target which currently changes the default NaN
at runtime (which it was previously doing indirectly when it
changed the snan_bit_is_one setting).

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-44-peter.maydell@linaro.org
---
 target/mips/fpu_helper.h | 7 +++++++
 target/mips/msa.c        | 3 +++
 2 files changed, 10 insertions(+)

diff --git a/target/mips/fpu_helper.h b/target/mips/fpu_helper.h
index XXXXXXX..XXXXXXX 100644
--- a/target/mips/fpu_helper.h
+++ b/target/mips/fpu_helper.h
@@ -XXX,XX +XXX,XX @@ static inline void restore_snan_bit_mode(CPUMIPSState *env)
     set_float_infzeronan_rule(izn_rule, &env->active_fpu.fp_status);
     nan3_rule = nan2008 ? float_3nan_prop_s_cab : float_3nan_prop_s_abc;
     set_float_3nan_prop_rule(nan3_rule, &env->active_fpu.fp_status);
+    /*
+     * With nan2008, the default NaN value has the sign bit clear and the
+     * frac msb set; with the older mode, the sign bit is clear, and all
+     * frac bits except the msb are set.
+     */
+    set_float_default_nan_pattern(nan2008 ? 0b01000000 : 0b00111111,
+                                  &env->active_fpu.fp_status);
 
 }
 
diff --git a/target/mips/msa.c b/target/mips/msa.c
index XXXXXXX..XXXXXXX 100644
--- a/target/mips/msa.c
+++ b/target/mips/msa.c
@@ -XXX,XX +XXX,XX @@ void msa_reset(CPUMIPSState *env)
     /* Inf * 0 + NaN returns the input NaN */
     set_float_infzeronan_rule(float_infzeronan_dnan_never,
                               &env->active_tc.msa_fp_status);
+    /* Default NaN: sign bit clear, frac msb set */
+    set_float_default_nan_pattern(0b01000000,
+                                  &env->active_tc.msa_fp_status);
 }
-- 
2.34.1

Set the default NaN pattern explicitly for SPARC, and remove
the ifdef from parts64_default_nan.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-50-peter.maydell@linaro.org
---
 target/sparc/cpu.c             | 2 ++
 fpu/softfloat-specialize.c.inc | 5 +----
 2 files changed, 3 insertions(+), 4 deletions(-)

diff --git a/target/sparc/cpu.c b/target/sparc/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/sparc/cpu.c
+++ b/target/sparc/cpu.c
@@ -XXX,XX +XXX,XX @@ static void sparc_cpu_realizefn(DeviceState *dev, Error **errp)
     set_float_3nan_prop_rule(float_3nan_prop_s_cba, &env->fp_status);
     /* For inf * 0 + NaN, return the input NaN */
     set_float_infzeronan_rule(float_infzeronan_dnan_never, &env->fp_status);
+    /* Default NaN value: sign bit clear, all frac bits set */
+    set_float_default_nan_pattern(0b01111111, &env->fp_status);
 
     cpu_exec_realizefn(cs, &local_err);
     if (local_err != NULL) {
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static void parts64_default_nan(FloatParts64 *p, float_status *status)
     uint8_t dnan_pattern = status->default_nan_pattern;
 
     if (dnan_pattern == 0) {
-#if defined(TARGET_SPARC)
-        /* Sign bit clear, all frac bits set */
-        dnan_pattern = 0b01111111;
-#elif defined(TARGET_HEXAGON)
+#if defined(TARGET_HEXAGON)
         /* Sign bit set, all frac bits set. */
         dnan_pattern = 0b11111111;
 #else
-- 
2.34.1

Set the default NaN pattern explicitly for hexagon.
Remove the ifdef from parts64_default_nan(); the only
remaining unconverted targets all use the default case.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-52-peter.maydell@linaro.org
---
 target/hexagon/cpu.c           | 2 ++
 fpu/softfloat-specialize.c.inc | 5 -----
 2 files changed, 2 insertions(+), 5 deletions(-)

diff --git a/target/hexagon/cpu.c b/target/hexagon/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/hexagon/cpu.c
+++ b/target/hexagon/cpu.c
@@ -XXX,XX +XXX,XX @@ static void hexagon_cpu_reset_hold(Object *obj, ResetType type)
 
     set_default_nan_mode(1, &env->fp_status);
     set_float_detect_tininess(float_tininess_before_rounding, &env->fp_status);
+    /* Default NaN value: sign bit set, all frac bits set */
+    set_float_default_nan_pattern(0b11111111, &env->fp_status);
 }
 
 static void hexagon_cpu_disas_set_info(CPUState *s, disassemble_info *info)
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static void parts64_default_nan(FloatParts64 *p, float_status *status)
     uint8_t dnan_pattern = status->default_nan_pattern;
 
     if (dnan_pattern == 0) {
-#if defined(TARGET_HEXAGON)
-        /* Sign bit set, all frac bits set. */
-        dnan_pattern = 0b11111111;
-#else
         /*
          * This case is true for Alpha, ARM, MIPS, OpenRISC, PPC, RISC-V,
          * S390, SH4, TriCore, and Xtensa.  Our other supported targets
@@ -XXX,XX +XXX,XX @@ static void parts64_default_nan(FloatParts64 *p, float_status *status)
             /* sign bit clear, set frac msb */
             dnan_pattern = 0b01000000;
         }
-#endif
     }
     assert(dnan_pattern != 0);
 
-- 
2.34.1

Now that all our targets have bene converted to explicitly specify
their pattern for the default NaN value we can remove the remaining
fallback code in parts64_default_nan().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241202131347.498124-55-peter.maydell@linaro.org
---
 fpu/softfloat-specialize.c.inc | 14 --------------
 1 file changed, 14 deletions(-)

diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static void parts64_default_nan(FloatParts64 *p, float_status *status)
     uint64_t frac;
     uint8_t dnan_pattern = status->default_nan_pattern;
 
-    if (dnan_pattern == 0) {
-        /*
-         * This case is true for Alpha, ARM, MIPS, OpenRISC, PPC, RISC-V,
-         * S390, SH4, TriCore, and Xtensa.  Our other supported targets
-         * do not have floating-point.
-         */
-        if (snan_bit_is_one(status)) {
-            /* sign bit clear, set all frac bits other than msb */
-            dnan_pattern = 0b00111111;
-        } else {
-            /* sign bit clear, set frac msb */
-            dnan_pattern = 0b01000000;
-        }
-    }
     assert(dnan_pattern != 0);
 
     sign = dnan_pattern >> 7;
-- 
2.34.1

From: Richard Henderson <richard.henderson@linaro.org>

Inline pickNaNMulAdd into its only caller.  This makes
one assert redundant with the immediately preceding IF.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <philmd@linaro.org>
Message-id: 20241203203949.483774-3-richard.henderson@linaro.org
[PMM: keep comment from old code in new location]
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 fpu/softfloat-parts.c.inc      | 41 +++++++++++++++++++++++++-
 fpu/softfloat-specialize.c.inc | 54 ----------------------------------
 2 files changed, 40 insertions(+), 55 deletions(-)

diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-parts.c.inc
+++ b/fpu/softfloat-parts.c.inc
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
     }
 
     if (s->default_nan_mode) {
+        /*
+         * We guarantee not to require the target to tell us how to
+         * pick a NaN if we're always returning the default NaN.
+         * But if we're not in default-NaN mode then the target must
+         * specify.
+         */
         which = 3;
+    } else if (infzero) {
+        /*
+         * Inf * 0 + NaN -- some implementations return the
+         * default NaN here, and some return the input NaN.
+         */
+        switch (s->float_infzeronan_rule) {
+        case float_infzeronan_dnan_never:
+            which = 2;
+            break;
+        case float_infzeronan_dnan_always:
+            which = 3;
+            break;
+        case float_infzeronan_dnan_if_qnan:
+            which = is_qnan(c->cls) ? 3 : 2;
+            break;
+        default:
+            g_assert_not_reached();
+        }
     } else {
-        which = pickNaNMulAdd(a->cls, b->cls, c->cls, infzero, have_snan, s);
+        FloatClass cls[3] = { a->cls, b->cls, c->cls };
+        Float3NaNPropRule rule = s->float_3nan_prop_rule;
+
+        assert(rule != float_3nan_prop_none);
+        if (have_snan && (rule & R_3NAN_SNAN_MASK)) {
+            /* We have at least one SNaN input and should prefer it */
+            do {
+                which = rule & R_3NAN_1ST_MASK;
+                rule >>= R_3NAN_1ST_LENGTH;
+            } while (!is_snan(cls[which]));
+        } else {
+            do {
+                which = rule & R_3NAN_1ST_MASK;
+                rule >>= R_3NAN_1ST_LENGTH;
+            } while (!is_nan(cls[which]));
+        }
     }
 
     if (which == 3) {
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ static int pickNaN(FloatClass a_cls, FloatClass b_cls,
     }
 }
 
-/*----------------------------------------------------------------------------
-| Select which NaN to propagate for a three-input operation.
-| For the moment we assume that no CPU needs the 'larger significand'
-| information.
-| Return values : 0 : a; 1 : b; 2 : c; 3 : default-NaN
-*----------------------------------------------------------------------------*/
-static int pickNaNMulAdd(FloatClass a_cls, FloatClass b_cls, FloatClass c_cls,
-                         bool infzero, bool have_snan, float_status *status)
-{
-    FloatClass cls[3] = { a_cls, b_cls, c_cls };
-    Float3NaNPropRule rule = status->float_3nan_prop_rule;
-    int which;
-
-    /*
-     * We guarantee not to require the target to tell us how to
-     * pick a NaN if we're always returning the default NaN.
-     * But if we're not in default-NaN mode then the target must
-     * specify.
-     */
-    assert(!status->default_nan_mode);
-
-    if (infzero) {
-        /*
-         * Inf * 0 + NaN -- some implementations return the default NaN here,
-         * and some return the input NaN.
-         */
-        switch (status->float_infzeronan_rule) {
-        case float_infzeronan_dnan_never:
-            return 2;
-        case float_infzeronan_dnan_always:
-            return 3;
-        case float_infzeronan_dnan_if_qnan:
-            return is_qnan(c_cls) ? 3 : 2;
-        default:
-            g_assert_not_reached();
-        }
-    }
-
-    assert(rule != float_3nan_prop_none);
-    if (have_snan && (rule & R_3NAN_SNAN_MASK)) {
-        /* We have at least one SNaN input and should prefer it */
-        do {
-            which = rule & R_3NAN_1ST_MASK;
-            rule >>= R_3NAN_1ST_LENGTH;
-        } while (!is_snan(cls[which]));
-    } else {
-        do {
-            which = rule & R_3NAN_1ST_MASK;
-            rule >>= R_3NAN_1ST_LENGTH;
-        } while (!is_nan(cls[which]));
-    }
-    return which;
-}
-
 /*----------------------------------------------------------------------------
 | Returns 1 if the double-precision floating-point value `a' is a quiet
 | NaN; otherwise returns 0.
-- 
2.34.1

From: Richard Henderson <richard.henderson@linaro.org>

Remove "3" as a special case for which and simply
branch to return the desired value.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <philmd@linaro.org>
Message-id: 20241203203949.483774-4-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 fpu/softfloat-parts.c.inc | 20 ++++++++++----------
 1 file changed, 10 insertions(+), 10 deletions(-)

diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-parts.c.inc
+++ b/fpu/softfloat-parts.c.inc
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
          * But if we're not in default-NaN mode then the target must
          * specify.
          */
-        which = 3;
+        goto default_nan;
     } else if (infzero) {
         /*
          * Inf * 0 + NaN -- some implementations return the
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
          */
         switch (s->float_infzeronan_rule) {
         case float_infzeronan_dnan_never:
-            which = 2;
             break;
         case float_infzeronan_dnan_always:
-            which = 3;
-            break;
+            goto default_nan;
         case float_infzeronan_dnan_if_qnan:
-            which = is_qnan(c->cls) ? 3 : 2;
+            if (is_qnan(c->cls)) {
+                goto default_nan;
+            }
             break;
         default:
             g_assert_not_reached();
         }
+        which = 2;
     } else {
         FloatClass cls[3] = { a->cls, b->cls, c->cls };
         Float3NaNPropRule rule = s->float_3nan_prop_rule;
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
         }
     }
 
-    if (which == 3) {
-        parts_default_nan(a, s);
-        return a;
-    }
-
     switch (which) {
     case 0:
         break;
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
         parts_silence_nan(a, s);
     }
     return a;
+
+ default_nan:
+    parts_default_nan(a, s);
+    return a;
 }
 
 /*
-- 
2.34.1

From: Richard Henderson <richard.henderson@linaro.org>

Assign the pointer return value to 'a' directly,
rather than going through an intermediary index.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <philmd@linaro.org>
Message-id: 20241203203949.483774-5-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 fpu/softfloat-parts.c.inc | 32 ++++++++++----------------------
 1 file changed, 10 insertions(+), 22 deletions(-)

diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-parts.c.inc
+++ b/fpu/softfloat-parts.c.inc
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
                                             FloatPartsN *c, float_status *s,
                                             int ab_mask, int abc_mask)
 {
-    int which;
     bool infzero = (ab_mask == float_cmask_infzero);
     bool have_snan = (abc_mask & float_cmask_snan);
+    FloatPartsN *ret;
 
     if (unlikely(have_snan)) {
         float_raise(float_flag_invalid | float_flag_invalid_snan, s);
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
         default:
             g_assert_not_reached();
         }
-        which = 2;
+        ret = c;
     } else {
-        FloatClass cls[3] = { a->cls, b->cls, c->cls };
+        FloatPartsN *val[3] = { a, b, c };
         Float3NaNPropRule rule = s->float_3nan_prop_rule;
 
         assert(rule != float_3nan_prop_none);
         if (have_snan && (rule & R_3NAN_SNAN_MASK)) {
             /* We have at least one SNaN input and should prefer it */
             do {
-                which = rule & R_3NAN_1ST_MASK;
+                ret = val[rule & R_3NAN_1ST_MASK];
                 rule >>= R_3NAN_1ST_LENGTH;
-            } while (!is_snan(cls[which]));
+            } while (!is_snan(ret->cls));
         } else {
             do {
-                which = rule & R_3NAN_1ST_MASK;
+                ret = val[rule & R_3NAN_1ST_MASK];
                 rule >>= R_3NAN_1ST_LENGTH;
-            } while (!is_nan(cls[which]));
+            } while (!is_nan(ret->cls));
         }
     }
 
-    switch (which) {
-    case 0:
-        break;
-    case 1:
-        a = b;
-        break;
-    case 2:
-        a = c;
-        break;
-    default:
-        g_assert_not_reached();
+    if (is_snan(ret->cls)) {
+        parts_silence_nan(ret, s);
     }
-    if (is_snan(a->cls)) {
-        parts_silence_nan(a, s);
-    }
-    return a;
+    return ret;
 
  default_nan:
     parts_default_nan(a, s);
-- 
2.34.1

From: Richard Henderson <richard.henderson@linaro.org>

While all indices into val[] should be in [0-2], the mask
applied is two bits.  To help static analysis see there is
no possibility of read beyond the end of the array, pad the
array to 4 entries, with the final being (implicitly) NULL.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <philmd@linaro.org>
Message-id: 20241203203949.483774-6-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 fpu/softfloat-parts.c.inc | 2 +-
 1 file changed, 1 insertion(+), 1 deletion(-)

diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-parts.c.inc
+++ b/fpu/softfloat-parts.c.inc
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
         }
         ret = c;
     } else {
-        FloatPartsN *val[3] = { a, b, c };
+        FloatPartsN *val[R_3NAN_1ST_MASK + 1] = { a, b, c };
         Float3NaNPropRule rule = s->float_3nan_prop_rule;
 
         assert(rule != float_3nan_prop_none);
-- 
2.34.1

From: Richard Henderson <richard.henderson@linaro.org>

This function is part of the public interface and
is not "specialized" to any target in any way.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20241203203949.483774-7-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 fpu/softfloat.c                | 52 ++++++++++++++++++++++++++++++++++
 fpu/softfloat-specialize.c.inc | 52 ----------------------------------
 2 files changed, 52 insertions(+), 52 deletions(-)

diff --git a/fpu/softfloat.c b/fpu/softfloat.c
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat.c
+++ b/fpu/softfloat.c
@@ -XXX,XX +XXX,XX @@ void normalizeFloatx80Subnormal(uint64_t aSig, int32_t *zExpPtr,
     *zExpPtr = 1 - shiftCount;
 }
 
+/*----------------------------------------------------------------------------
+| Takes two extended double-precision floating-point values `a' and `b', one
+| of which is a NaN, and returns the appropriate NaN result.  If either `a' or
+| `b' is a signaling NaN, the invalid exception is raised.
+*----------------------------------------------------------------------------*/
+
+floatx80 propagateFloatx80NaN(floatx80 a, floatx80 b, float_status *status)
+{
+    bool aIsLargerSignificand;
+    FloatClass a_cls, b_cls;
+
+    /* This is not complete, but is good enough for pickNaN.  */
+    a_cls = (!floatx80_is_any_nan(a)
+             ? float_class_normal
+             : floatx80_is_signaling_nan(a, status)
+             ? float_class_snan
+             : float_class_qnan);
+    b_cls = (!floatx80_is_any_nan(b)
+             ? float_class_normal
+             : floatx80_is_signaling_nan(b, status)
+             ? float_class_snan
+             : float_class_qnan);
+
+    if (is_snan(a_cls) || is_snan(b_cls)) {
+        float_raise(float_flag_invalid, status);
+    }
+
+    if (status->default_nan_mode) {
+        return floatx80_default_nan(status);
+    }
+
+    if (a.low < b.low) {
+        aIsLargerSignificand = 0;
+    } else if (b.low < a.low) {
+        aIsLargerSignificand = 1;
+    } else {
+        aIsLargerSignificand = (a.high < b.high) ? 1 : 0;
+    }
+
+    if (pickNaN(a_cls, b_cls, aIsLargerSignificand, status)) {
+        if (is_snan(b_cls)) {
+            return floatx80_silence_nan(b, status);
+        }
+        return b;
+    } else {
+        if (is_snan(a_cls)) {
+            return floatx80_silence_nan(a, status);
+        }
+        return a;
+    }
+}
+
 /*----------------------------------------------------------------------------
 | Takes an abstract floating-point value having sign `zSign', exponent `zExp',
 | and extended significand formed by the concatenation of `zSig0' and `zSig1',
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ floatx80 floatx80_silence_nan(floatx80 a, float_status *status)
     return a;
 }
 
-/*----------------------------------------------------------------------------
-| Takes two extended double-precision floating-point values `a' and `b', one
-| of which is a NaN, and returns the appropriate NaN result.  If either `a' or
-| `b' is a signaling NaN, the invalid exception is raised.
-*----------------------------------------------------------------------------*/
-
-floatx80 propagateFloatx80NaN(floatx80 a, floatx80 b, float_status *status)
-{
-    bool aIsLargerSignificand;
-    FloatClass a_cls, b_cls;
-
-    /* This is not complete, but is good enough for pickNaN.  */
-    a_cls = (!floatx80_is_any_nan(a)
-             ? float_class_normal
-             : floatx80_is_signaling_nan(a, status)
-             ? float_class_snan
-             : float_class_qnan);
-    b_cls = (!floatx80_is_any_nan(b)
-             ? float_class_normal
-             : floatx80_is_signaling_nan(b, status)
-             ? float_class_snan
-             : float_class_qnan);
-
-    if (is_snan(a_cls) || is_snan(b_cls)) {
-        float_raise(float_flag_invalid, status);
-    }
-
-    if (status->default_nan_mode) {
-        return floatx80_default_nan(status);
-    }
-
-    if (a.low < b.low) {
-        aIsLargerSignificand = 0;
-    } else if (b.low < a.low) {
-        aIsLargerSignificand = 1;
-    } else {
-        aIsLargerSignificand = (a.high < b.high) ? 1 : 0;
-    }
-
-    if (pickNaN(a_cls, b_cls, aIsLargerSignificand, status)) {
-        if (is_snan(b_cls)) {
-            return floatx80_silence_nan(b, status);
-        }
-        return b;
-    } else {
-        if (is_snan(a_cls)) {
-            return floatx80_silence_nan(a, status);
-        }
-        return a;
-    }
-}
-
 /*----------------------------------------------------------------------------
 | Returns 1 if the quadruple-precision floating-point value `a' is a quiet
 | NaN; otherwise returns 0.
-- 
2.34.1

From: Richard Henderson <richard.henderson@linaro.org>

Unpacking and repacking the parts may be slightly more work
than we did before, but we get to reuse more code.  For a
code path handling exceptional values, this is an improvement.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20241203203949.483774-8-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
---
 fpu/softfloat.c | 43 +++++--------------------------------------
 1 file changed, 5 insertions(+), 38 deletions(-)

diff --git a/fpu/softfloat.c b/fpu/softfloat.c
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat.c
+++ b/fpu/softfloat.c
@@ -XXX,XX +XXX,XX @@ void normalizeFloatx80Subnormal(uint64_t aSig, int32_t *zExpPtr,
 
 floatx80 propagateFloatx80NaN(floatx80 a, floatx80 b, float_status *status)
 {
-    bool aIsLargerSignificand;
-    FloatClass a_cls, b_cls;
+    FloatParts128 pa, pb, *pr;
 
-    /* This is not complete, but is good enough for pickNaN.  */
-    a_cls = (!floatx80_is_any_nan(a)
-             ? float_class_normal
-             : floatx80_is_signaling_nan(a, status)
-             ? float_class_snan
-             : float_class_qnan);
-    b_cls = (!floatx80_is_any_nan(b)
-             ? float_class_normal
-             : floatx80_is_signaling_nan(b, status)
-             ? float_class_snan
-             : float_class_qnan);
-
-    if (is_snan(a_cls) || is_snan(b_cls)) {
-        float_raise(float_flag_invalid, status);
-    }
-
-    if (status->default_nan_mode) {
+    if (!floatx80_unpack_canonical(&pa, a, status) ||
+        !floatx80_unpack_canonical(&pb, b, status)) {
         return floatx80_default_nan(status);
     }
 
-    if (a.low < b.low) {
-        aIsLargerSignificand = 0;
-    } else if (b.low < a.low) {
-        aIsLargerSignificand = 1;
-    } else {
-        aIsLargerSignificand = (a.high < b.high) ? 1 : 0;
-    }
-
-    if (pickNaN(a_cls, b_cls, aIsLargerSignificand, status)) {
-        if (is_snan(b_cls)) {
-            return floatx80_silence_nan(b, status);
-        }
-        return b;
-    } else {
-        if (is_snan(a_cls)) {
-            return floatx80_silence_nan(a, status);
-        }
-        return a;
-    }
+    pr = parts_pick_nan(&pa, &pb, status);
+    return floatx80_round_pack_canonical(pr, status);
 }
 
 /*----------------------------------------------------------------------------
-- 
2.34.1

From: Richard Henderson <richard.henderson@linaro.org>

Inline pickNaN into its only caller.  This makes one assert
redundant with the immediately preceding IF.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <philmd@linaro.org>
Message-id: 20241203203949.483774-9-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 fpu/softfloat-parts.c.inc      | 82 +++++++++++++++++++++++++----
 fpu/softfloat-specialize.c.inc | 96 ----------------------------------
 2 files changed, 73 insertions(+), 105 deletions(-)

diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-parts.c.inc
+++ b/fpu/softfloat-parts.c.inc
@@ -XXX,XX +XXX,XX @@ static void partsN(return_nan)(FloatPartsN *a, float_status *s)
 static FloatPartsN *partsN(pick_nan)(FloatPartsN *a, FloatPartsN *b,
                                      float_status *s)
 {
+    int cmp, which;
+
     if (is_snan(a->cls) || is_snan(b->cls)) {
         float_raise(float_flag_invalid | float_flag_invalid_snan, s);
     }
 
     if (s->default_nan_mode) {
         parts_default_nan(a, s);
-    } else {
-        int cmp = frac_cmp(a, b);
-        if (cmp == 0) {
-            cmp = a->sign < b->sign;
-        }
+        return a;
+    }
 
-        if (pickNaN(a->cls, b->cls, cmp > 0, s)) {
-            a = b;
-        }
+    cmp = frac_cmp(a, b);
+    if (cmp == 0) {
+        cmp = a->sign < b->sign;
+    }
+
+    switch (s->float_2nan_prop_rule) {
+    case float_2nan_prop_s_ab:
         if (is_snan(a->cls)) {
-            parts_silence_nan(a, s);
+            which = 0;
+        } else if (is_snan(b->cls)) {
+            which = 1;
+        } else if (is_qnan(a->cls)) {
+            which = 0;
+        } else {
+            which = 1;
         }
+        break;
+    case float_2nan_prop_s_ba:
+        if (is_snan(b->cls)) {
+            which = 1;
+        } else if (is_snan(a->cls)) {
+            which = 0;
+        } else if (is_qnan(b->cls)) {
+            which = 1;
+        } else {
+            which = 0;
+        }
+        break;
+    case float_2nan_prop_ab:
+        which = is_nan(a->cls) ? 0 : 1;
+        break;
+    case float_2nan_prop_ba:
+        which = is_nan(b->cls) ? 1 : 0;
+        break;
+    case float_2nan_prop_x87:
+        /*
+         * This implements x87 NaN propagation rules:
+         * SNaN + QNaN => return the QNaN
+         * two SNaNs => return the one with the larger significand, silenced
+         * two QNaNs => return the one with the larger significand
+         * SNaN and a non-NaN => return the SNaN, silenced
+         * QNaN and a non-NaN => return the QNaN
+         *
+         * If we get down to comparing significands and they are the same,
+         * return the NaN with the positive sign bit (if any).
+         */
+        if (is_snan(a->cls)) {
+            if (is_snan(b->cls)) {
+                which = cmp > 0 ? 0 : 1;
+            } else {
+                which = is_qnan(b->cls) ? 1 : 0;
+            }
+        } else if (is_qnan(a->cls)) {
+            if (is_snan(b->cls) || !is_qnan(b->cls)) {
+                which = 0;
+            } else {
+                which = cmp > 0 ? 0 : 1;
+            }
+        } else {
+            which = 1;
+        }
+        break;
+    default:
+        g_assert_not_reached();
+    }
+
+    if (which) {
+        a = b;
+    }
+    if (is_snan(a->cls)) {
+        parts_silence_nan(a, s);
     }
     return a;
 }
diff --git a/fpu/softfloat-specialize.c.inc b/fpu/softfloat-specialize.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-specialize.c.inc
+++ b/fpu/softfloat-specialize.c.inc
@@ -XXX,XX +XXX,XX @@ bool float32_is_signaling_nan(float32 a_, float_status *status)
     }
 }
 
-/*----------------------------------------------------------------------------
-| Select which NaN to propagate for a two-input operation.
-| IEEE754 doesn't specify all the details of this, so the
-| algorithm is target-specific.
-| The routine is passed various bits of information about the
-| two NaNs and should return 0 to select NaN a and 1 for NaN b.
-| Note that signalling NaNs are always squashed to quiet NaNs
-| by the caller, by calling floatXX_silence_nan() before
-| returning them.
-|
-| aIsLargerSignificand is only valid if both a and b are NaNs
-| of some kind, and is true if a has the larger significand,
-| or if both a and b have the same significand but a is
-| positive but b is negative. It is only needed for the x87
-| tie-break rule.
-*----------------------------------------------------------------------------*/
-
-static int pickNaN(FloatClass a_cls, FloatClass b_cls,
-                   bool aIsLargerSignificand, float_status *status)
-{
-    /*
-     * We guarantee not to require the target to tell us how to
-     * pick a NaN if we're always returning the default NaN.
-     * But if we're not in default-NaN mode then the target must
-     * specify via set_float_2nan_prop_rule().
-     */
-    assert(!status->default_nan_mode);
-
-    switch (status->float_2nan_prop_rule) {
-    case float_2nan_prop_s_ab:
-        if (is_snan(a_cls)) {
-            return 0;
-        } else if (is_snan(b_cls)) {
-            return 1;
-        } else if (is_qnan(a_cls)) {
-            return 0;
-        } else {
-            return 1;
-        }
-        break;
-    case float_2nan_prop_s_ba:
-        if (is_snan(b_cls)) {
-            return 1;
-        } else if (is_snan(a_cls)) {
-            return 0;
-        } else if (is_qnan(b_cls)) {
-            return 1;
-        } else {
-            return 0;
-        }
-        break;
-    case float_2nan_prop_ab:
-        if (is_nan(a_cls)) {
-            return 0;
-        } else {
-            return 1;
-        }
-        break;
-    case float_2nan_prop_ba:
-        if (is_nan(b_cls)) {
-            return 1;
-        } else {
-            return 0;
-        }
-        break;
-    case float_2nan_prop_x87:
-        /*
-         * This implements x87 NaN propagation rules:
-         * SNaN + QNaN => return the QNaN
-         * two SNaNs => return the one with the larger significand, silenced
-         * two QNaNs => return the one with the larger significand
-         * SNaN and a non-NaN => return the SNaN, silenced
-         * QNaN and a non-NaN => return the QNaN
-         *
-         * If we get down to comparing significands and they are the same,
-         * return the NaN with the positive sign bit (if any).
-         */
-        if (is_snan(a_cls)) {
-            if (is_snan(b_cls)) {
-                return aIsLargerSignificand ? 0 : 1;
-            }
-            return is_qnan(b_cls) ? 1 : 0;
-        } else if (is_qnan(a_cls)) {
-            if (is_snan(b_cls) || !is_qnan(b_cls)) {
-                return 0;
-            } else {
-                return aIsLargerSignificand ? 0 : 1;
-            }
-        } else {
-            return 1;
-        }
-    default:
-        g_assert_not_reached();
-    }
-}
-
 /*----------------------------------------------------------------------------
 | Returns 1 if the double-precision floating-point value `a' is a quiet
 | NaN; otherwise returns 0.
-- 
2.34.1

From: Richard Henderson <richard.henderson@linaro.org>

Remember if there was an SNaN, and use that to simplify
float_2nan_prop_s_{ab,ba} to only the snan component.
Then, fall through to the corresponding
float_2nan_prop_{ab,ba} case to handle any remaining
nans, which must be quiet.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20241203203949.483774-10-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 fpu/softfloat-parts.c.inc | 32 ++++++++++++--------------------
 1 file changed, 12 insertions(+), 20 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Move the fractional comparison to the end of the
float_2nan_prop_x87 case.  This is not required for
any other 2nan propagation rule.  Reorganize the
x87 case itself to break out of the switch when the
fractional comparison is not required.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20241203203949.483774-11-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 fpu/softfloat-parts.c.inc | 19 +++++++++----------
 1 file changed, 9 insertions(+), 10 deletions(-)

diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-parts.c.inc
+++ b/fpu/softfloat-parts.c.inc
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan)(FloatPartsN *a, FloatPartsN *b,
         return a;
     }
 
-    cmp = frac_cmp(a, b);
-    if (cmp == 0) {
-        cmp = a->sign < b->sign;
-    }
-
     switch (s->float_2nan_prop_rule) {
     case float_2nan_prop_s_ab:
         if (have_snan) {
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan)(FloatPartsN *a, FloatPartsN *b,
          * return the NaN with the positive sign bit (if any).
          */
         if (is_snan(a->cls)) {
-            if (is_snan(b->cls)) {
-                which = cmp > 0 ? 0 : 1;
-            } else {
+            if (!is_snan(b->cls)) {
                 which = is_qnan(b->cls) ? 1 : 0;
+                break;
             }
         } else if (is_qnan(a->cls)) {
             if (is_snan(b->cls) || !is_qnan(b->cls)) {
                 which = 0;
-            } else {
-                which = cmp > 0 ? 0 : 1;
+                break;
             }
         } else {
             which = 1;
+            break;
         }
+        cmp = frac_cmp(a, b);
+        if (cmp == 0) {
+            cmp = a->sign < b->sign;
+        }
+        which = cmp > 0 ? 0 : 1;
         break;
     default:
         g_assert_not_reached();
-- 
2.34.1

From: Richard Henderson <richard.henderson@linaro.org>

Replace the "index" selecting between A and B with a result variable
of the proper type.  This improves clarity within the function.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <philmd@linaro.org>
Message-id: 20241203203949.483774-12-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 fpu/softfloat-parts.c.inc | 28 +++++++++++++---------------
 1 file changed, 13 insertions(+), 15 deletions(-)

diff --git a/fpu/softfloat-parts.c.inc b/fpu/softfloat-parts.c.inc
index XXXXXXX..XXXXXXX 100644
--- a/fpu/softfloat-parts.c.inc
+++ b/fpu/softfloat-parts.c.inc
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan)(FloatPartsN *a, FloatPartsN *b,
                                      float_status *s)
 {
     bool have_snan = false;
-    int cmp, which;
+    FloatPartsN *ret;
+    int cmp;
 
     if (is_snan(a->cls) || is_snan(b->cls)) {
         float_raise(float_flag_invalid | float_flag_invalid_snan, s);
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan)(FloatPartsN *a, FloatPartsN *b,
     switch (s->float_2nan_prop_rule) {
     case float_2nan_prop_s_ab:
         if (have_snan) {
-            which = is_snan(a->cls) ? 0 : 1;
+            ret = is_snan(a->cls) ? a : b;
             break;
         }
         /* fall through */
     case float_2nan_prop_ab:
-        which = is_nan(a->cls) ? 0 : 1;
+        ret = is_nan(a->cls) ? a : b;
         break;
     case float_2nan_prop_s_ba:
         if (have_snan) {
-            which = is_snan(b->cls) ? 1 : 0;
+            ret = is_snan(b->cls) ? b : a;
             break;
         }
         /* fall through */
     case float_2nan_prop_ba:
-        which = is_nan(b->cls) ? 1 : 0;
+        ret = is_nan(b->cls) ? b : a;
         break;
     case float_2nan_prop_x87:
         /*
@@ -XXX,XX +XXX,XX @@ static FloatPartsN *partsN(pick_nan)(FloatPartsN *a, FloatPartsN *b,
          */
         if (is_snan(a->cls)) {
             if (!is_snan(b->cls)) {
-                which = is_qnan(b->cls) ? 1 : 0;
+                ret = is_qnan(b->cls) ? b : a;
                 break;
             }
         } else if (is_qnan(a->cls)) {
             if (is_snan(b->cls) || !is_qnan(b->cls)) {
-                which = 0;
+                ret = a;
                 break;
             }
         } else {
-            which = 1;
+            ret = b;
             break;
         }
         cmp = frac_cmp(a, b);
         if (cmp == 0) {
             cmp = a->sign < b->sign;
         }
-        which = cmp > 0 ? 0 : 1;
+        ret = cmp > 0 ? a : b;
         break;
     default:
         g_assert_not_reached();
     }
 
-    if (which) {
-        a = b;
+    if (is_snan(ret->cls)) {
+        parts_silence_nan(ret, s);
     }
-    if (is_snan(a->cls)) {
-        parts_silence_nan(a, s);
-    }
-    return a;
+    return ret;
 }
 
 static FloatPartsN *partsN(pick_nan_muladd)(FloatPartsN *a, FloatPartsN *b,
-- 
2.34.1

From: Leif Lindholm <quic_llindhol@quicinc.com>

I'm migrating to Qualcomm's new open source email infrastructure, so
update my email address, and update the mailmap to match.

Signed-off-by: Leif Lindholm <leif.lindholm@oss.qualcomm.com>
Reviewed-by: Leif Lindholm <quic_llindhol@quicinc.com>
Reviewed-by: Brian Cain <brian.cain@oss.qualcomm.com>
Reviewed-by: Philippe Mathieu-Daudé <philmd@linaro.org>
Tested-by: Philippe Mathieu-Daudé <philmd@linaro.org>
Message-id: 20241205114047.1125842-1-leif.lindholm@oss.qualcomm.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 MAINTAINERS | 2 +-
 .mailmap    | 5 +++--
 2 files changed, 4 insertions(+), 3 deletions(-)

diff --git a/MAINTAINERS b/MAINTAINERS
index XXXXXXX..XXXXXXX 100644
--- a/MAINTAINERS
+++ b/MAINTAINERS
@@ -XXX,XX +XXX,XX @@ F: include/hw/ssi/imx_spi.h
 SBSA-REF
 M: Radoslaw Biernacki <rad@semihalf.com>
 M: Peter Maydell <peter.maydell@linaro.org>
-R: Leif Lindholm <quic_llindhol@quicinc.com>
+R: Leif Lindholm <leif.lindholm@oss.qualcomm.com>
 R: Marcin Juszkiewicz <marcin.juszkiewicz@linaro.org>
 L: qemu-arm@nongnu.org
 S: Maintained
diff --git a/.mailmap b/.mailmap
index XXXXXXX..XXXXXXX 100644
--- a/.mailmap
+++ b/.mailmap
@@ -XXX,XX +XXX,XX @@ Huacai Chen <chenhuacai@kernel.org> <chenhc@lemote.com>
 Huacai Chen <chenhuacai@kernel.org> <chenhuacai@loongson.cn>
 James Hogan <jhogan@kernel.org> <james.hogan@imgtec.com>
 Juan Quintela <quintela@trasno.org> <quintela@redhat.com>
-Leif Lindholm <quic_llindhol@quicinc.com> <leif.lindholm@linaro.org>
-Leif Lindholm <quic_llindhol@quicinc.com> <leif@nuviainc.com>
+Leif Lindholm <leif.lindholm@oss.qualcomm.com> <quic_llindhol@quicinc.com>
+Leif Lindholm <leif.lindholm@oss.qualcomm.com> <leif.lindholm@linaro.org>
+Leif Lindholm <leif.lindholm@oss.qualcomm.com> <leif@nuviainc.com>
 Luc Michel <luc@lmichel.fr> <luc.michel@git.antfield.fr>
 Luc Michel <luc@lmichel.fr> <luc.michel@greensocs.com>
 Luc Michel <luc@lmichel.fr> <lmichel@kalray.eu>
-- 
2.34.1

From: Vikram Garhwal <vikram.garhwal@bytedance.com>

Previously, maintainer role was paused due to inactive email id. Commit id:
c009d715721861984c4987bcc78b7ee183e86d75.

Signed-off-by: Vikram Garhwal <vikram.garhwal@bytedance.com>
Reviewed-by: Francisco Iglesias <francisco.iglesias@amd.com>
Message-id: 20241204184205.12952-1-vikram.garhwal@bytedance.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 MAINTAINERS | 2 ++
 1 file changed, 2 insertions(+)

diff --git a/MAINTAINERS b/MAINTAINERS
index XXXXXXX..XXXXXXX 100644
--- a/MAINTAINERS
+++ b/MAINTAINERS
@@ -XXX,XX +XXX,XX @@ F: tests/qtest/fuzz-sb16-test.c
 
 Xilinx CAN
 M: Francisco Iglesias <francisco.iglesias@amd.com>
+M: Vikram Garhwal <vikram.garhwal@bytedance.com>
 S: Maintained
 F: hw/net/can/xlnx-*
 F: include/hw/net/xlnx-*
@@ -XXX,XX +XXX,XX @@ F: include/hw/rx/
 CAN bus subsystem and hardware
 M: Pavel Pisa <pisa@cmp.felk.cvut.cz>
 M: Francisco Iglesias <francisco.iglesias@amd.com>
+M: Vikram Garhwal <vikram.garhwal@bytedance.com>
 S: Maintained
 W: https://canbus.pages.fel.cvut.cz/
 F: net/can/*
-- 
2.34.1