Series comparison

-[Qemu-devel] [PULL 00/55] target-arm queue
+[Qemu-devel] [PULL 00/42] target-arm queue
-Hopefully last target-arm queue before softfreeze;
+First pullreq for arm of the 4.1 series, since I'm back from
-this one's largest part is the remainder of the SVE patches,
+holiday now. This is mostly my M-profile FPU series and Philippe's
-but there are a selection of other minor things too.
+devices.h cleanup. I have a pile of other patchsets to work through
 in my to-review folder, but 42 patches is definitely quite
 big enough to send now...
 thanks
 -- PMM
-The following changes since commit 109b25045b3651f9c5d02c3766c0b3ff63e6d193:
+The following changes since commit 413a99a92c13ec408dcf2adaa87918dc81e890c8:
-  Merge remote-tracking branch 'remotes/bonzini/tags/for-upstream' into staging (2018-06-29 12:30:29 +0100)
+  Add Nios II semihosting support. (2019-04-29 16:09:51 +0100)
 are available in the Git repository at:
-  git://git.linaro.org/people/pmaydell/qemu-arm.git tags/pull-target-arm-20180629
+  https://git.linaro.org/people/pmaydell/qemu-arm.git tags/pull-target-arm-20190429
-for you to fetch changes up to 802abf4024d23e48d45373ac3f2b580124b54b47:
+for you to fetch changes up to 437cc27ddfded3bbab6afd5ac1761e0e195edba7:
-  target/arm: Add ID_ISAR6 (2018-06-29 15:30:54 +0100)
+  hw/devices: Move SMSC 91C111 declaration into a new header (2019-04-29 17:57:21 +0100)
 ----------------------------------------------------------------
 target-arm queue:
- * last of the SVE patches; SVE is now enabled for aarch64 linux-user
+ * remove "bag of random stuff" hw/devices.h header
- * sd: Don't trace SDRequest crc field (coverity bugfix)
+ * implement FPU for Cortex-M and enable it for Cortex-M4 and -M33
- * target/arm: Mark PMINTENSET accesses as possibly doing IO
+ * hw/dma: Compile the bcm2835_dma device as common object
- * clean up v7VE feature bit handling
+ * configure: Remove --source-path option
- * i.mx7d: minor cleanups
+ * hw/ssi/xilinx_spips: Avoid variable length array
- * target/arm: support reading of CNT[VCT|FRQ]_EL0 from user-space
+ * hw/arm/smmuv3: Remove SMMUNotifierNode
  * target/arm: Implement ARMv8.2-DotProd
  * virt: add addresses to dt node names (which stops dtc from
    complaining that they're not correctly named)
  * cleanups: replace error_setg(&error_fatal) by error_report() + exit()
 ----------------------------------------------------------------
-Aaron Lindsay (3):
+Eric Auger (1):
-      target/arm: Add ARM_FEATURE_V7VE for v7 Virtualization Extensions
+      hw/arm/smmuv3: Remove SMMUNotifierNode
       target/arm: Remove redundant DIV detection for KVM
       target/arm: Mark PMINTENSET accesses as possibly doing IO
-Alex Bennée (1):
+Peter Maydell (28):
-      target/arm: support reading of CNT[VCT|FRQ]_EL0 from user-space
+      hw/ssi/xilinx_spips: Avoid variable length array
       configure: Remove --source-path option
       target/arm: Make sure M-profile FPSCR RES0 bits are not settable
       hw/intc/armv7m_nvic: Allow reading of M-profile MVFR* registers
       target/arm: Implement dummy versions of M-profile FP-related registers
       target/arm: Disable most VFP sysregs for M-profile
       target/arm: Honour M-profile FP enable bits
       target/arm: Decode FP instructions for M profile
       target/arm: Clear CONTROL_S.SFPA in SG insn if FPU present
       target/arm: Handle SFPA and FPCA bits in reads and writes of CONTROL
       target/arm/helper: don't return early for STKOF faults during stacking
       target/arm: Handle floating point registers in exception entry
       target/arm: Implement v7m_update_fpccr()
       target/arm: Clear CONTROL.SFPA in BXNS and BLXNS
       target/arm: Clean excReturn bits when tail chaining
       target/arm: Allow for floating point in callee stack integrity check
       target/arm: Handle floating point registers in exception return
       target/arm: Move NS TBFLAG from bit 19 to bit 6
       target/arm: Overlap VECSTRIDE and XSCALE_CPAR TB flags
       target/arm: Set FPCCR.S when executing M-profile floating point insns
       target/arm: Activate M-profile floating point context when FPCCR.ASPEN is set
       target/arm: New helper function arm_v7m_mmu_idx_all()
       target/arm: New function armv7m_nvic_set_pending_lazyfp()
       target/arm: Add lazy-FP-stacking support to v7m_stack_write()
       target/arm: Implement M-profile lazy FP state preservation
       target/arm: Implement VLSTM for v7M CPUs with an FPU
       target/arm: Implement VLLDM for v7M CPUs with an FPU
       target/arm: Enable FPU for Cortex-M4 and Cortex-M33
-Eric Auger (3):
+Philippe Mathieu-Daudé (13):
-      device_tree: Add qemu_fdt_node_unit_path
+      hw/dma: Compile the bcm2835_dma device as common object
-      hw/arm/virt: Silence dtc /intc warnings
+      hw/arm/aspeed: Use TYPE_TMP105/TYPE_PCA9552 instead of hardcoded string
-      hw/arm/virt: Silence dtc /memory warning
+      hw/arm/nseries: Use TYPE_TMP105 instead of hardcoded string
       hw/display/tc6393xb: Remove unused functions
       hw/devices: Move TC6393XB declarations into a new header
       hw/devices: Move Blizzard declarations into a new header
       hw/devices: Move CBus declarations into a new header
       hw/devices: Move Gamepad declarations into a new header
       hw/devices: Move TI touchscreen declarations into a new header
       hw/devices: Move LAN9118 declarations into a new header
       hw/net/ne2000-isa: Add guards to the header
       hw/net/lan9118: Export TYPE_LAN9118 and use it instead of hardcoded string
       hw/devices: Move SMSC 91C111 declaration into a new header
-Jean-Christophe Dubois (3):
+ configure                     |  10 +-
-      i.mx7d: Remove unused header files
+ hw/dma/Makefile.objs          |   2 +-
-      i.mx7d: Change SRC unimplemented device name from sdma to src
+ include/hw/arm/omap.h         |   6 +-
-      i.mx7d: Change IRQ number type from hwaddr to int
+ include/hw/arm/smmu-common.h  |   8 +-
  include/hw/devices.h          |  62 ---
  include/hw/display/blizzard.h |  22 ++
  include/hw/display/tc6393xb.h |  24 ++
  include/hw/input/gamepad.h    |  19 +
  include/hw/input/tsc2xxx.h    |  36 ++
  include/hw/misc/cbus.h        |  32 ++
  include/hw/net/lan9118.h      |  21 +
  include/hw/net/ne2000-isa.h   |   6 +
  include/hw/net/smc91c111.h    |  19 +
  include/qemu/typedefs.h       |   1 -
  target/arm/cpu.h              |  95 ++++-
  target/arm/helper.h           |   5 +
  target/arm/translate.h        |   3 +
  hw/arm/aspeed.c               |  13 +-
  hw/arm/exynos4_boards.c       |   3 +-
  hw/arm/gumstix.c              |   2 +-
  hw/arm/integratorcp.c         |   2 +-
  hw/arm/kzm.c                  |   2 +-
  hw/arm/mainstone.c            |   2 +-
  hw/arm/mps2-tz.c              |   3 +-
  hw/arm/mps2.c                 |   2 +-
  hw/arm/nseries.c              |   7 +-
  hw/arm/palm.c                 |   2 +-
  hw/arm/realview.c             |   3 +-
  hw/arm/smmu-common.c          |   6 +-
  hw/arm/smmuv3.c               |  28 +-
  hw/arm/stellaris.c            |   2 +-
  hw/arm/tosa.c                 |   2 +-
  hw/arm/versatilepb.c          |   2 +-
  hw/arm/vexpress.c             |   2 +-
  hw/display/blizzard.c         |   2 +-
  hw/display/tc6393xb.c         |  18 +-
  hw/input/stellaris_input.c    |   2 +-
  hw/input/tsc2005.c            |   2 +-
  hw/input/tsc210x.c            |   4 +-
  hw/intc/armv7m_nvic.c         | 261 +++++++++++++
  hw/misc/cbus.c                |   2 +-
  hw/net/lan9118.c              |   3 +-
  hw/net/smc91c111.c            |   2 +-
  hw/ssi/xilinx_spips.c         |   6 +-
  target/arm/cpu.c              |  20 +
  target/arm/helper.c           | 873 +++++++++++++++++++++++++++++++++++++++---
  target/arm/machine.c          |  16 +
  target/arm/translate.c        | 150 +++++++-
  target/arm/vfp_helper.c       |   8 +
  MAINTAINERS                   |   7 +
 files changed, 1595 insertions(+), 235 deletions(-)
  delete mode 100644 include/hw/devices.h
  create mode 100644 include/hw/display/blizzard.h
  create mode 100644 include/hw/display/tc6393xb.h
  create mode 100644 include/hw/input/gamepad.h
  create mode 100644 include/hw/input/tsc2xxx.h
  create mode 100644 include/hw/misc/cbus.h
  create mode 100644 include/hw/net/lan9118.h
  create mode 100644 include/hw/net/smc91c111.h
-Peter Maydell (1):
-      sd: Don't trace SDRequest crc field
-Philippe Mathieu-Daudé (4):
-      hw/block/fdc: Replace error_setg(&error_abort) by assert()
-      hw/arm/sysbus-fdt: Replace error_setg(&error_fatal) by error_report() + exit()
-      device_tree: Replace error_setg(&error_fatal) by error_report() + exit()
-      sdcard: Use the ldst API
-Richard Henderson (40):
-      target/arm: Implement SVE Memory Contiguous Load Group
-      target/arm: Implement SVE Contiguous Load, first-fault and no-fault
-      target/arm: Implement SVE Memory Contiguous Store Group
-      target/arm: Implement SVE load and broadcast quadword
-      target/arm: Implement SVE integer convert to floating-point
-      target/arm: Implement SVE floating-point arithmetic (predicated)
-      target/arm: Implement SVE FP Multiply-Add Group
-      target/arm: Implement SVE Floating Point Accumulating Reduction Group
-      target/arm: Implement SVE load and broadcast element
-      target/arm: Implement SVE store vector/predicate register
-      target/arm: Implement SVE scatter stores
-      target/arm: Implement SVE prefetches
-      target/arm: Implement SVE gather loads
-      target/arm: Implement SVE first-fault gather loads
-      target/arm: Implement SVE scatter store vector immediate
-      target/arm: Implement SVE floating-point compare vectors
-      target/arm: Implement SVE floating-point arithmetic with immediate
-      target/arm: Implement SVE Floating Point Multiply Indexed Group
-      target/arm: Implement SVE FP Fast Reduction Group
-      target/arm: Implement SVE Floating Point Unary Operations - Unpredicated Group
-      target/arm: Implement SVE FP Compare with Zero Group
-      target/arm: Implement SVE floating-point trig multiply-add coefficient
-      target/arm: Implement SVE floating-point convert precision
-      target/arm: Implement SVE floating-point convert to integer
-      target/arm: Implement SVE floating-point round to integral value
-      target/arm: Implement SVE floating-point unary operations
-      target/arm: Implement SVE MOVPRFX
-      target/arm: Implement SVE floating-point complex add
-      target/arm: Implement SVE fp complex multiply add
-      target/arm: Pass index to AdvSIMD FCMLA (indexed)
-      target/arm: Implement SVE fp complex multiply add (indexed)
-      target/arm: Implement SVE dot product (vectors)
-      target/arm: Implement SVE dot product (indexed)
-      target/arm: Enable SVE for aarch64-linux-user
-      target/arm: Implement ARMv8.2-DotProd
-      target/arm: Fix SVE signed division vs x86 overflow exception
-      target/arm: Fix SVE system register access checks
-      target/arm: Prune a57 features from max
-      target/arm: Prune a15 features from max
-      target/arm: Add ID_ISAR6
- include/sysemu/device_tree.h |   16 +
- target/arm/cpu.h             |    3 +
- target/arm/helper-sve.h      |  682 +++++++++++++++
- target/arm/helper.h          |   44 +-
- device_tree.c                |   78 +-
- hw/arm/boot.c                |   41 +-
- hw/arm/fsl-imx7.c            |    8 +-
- hw/arm/mcimx7d-sabre.c       |    2 -
- hw/arm/sysbus-fdt.c          |   53 +-
- hw/arm/virt.c                |   70 +-
- hw/block/fdc.c               |    9 +-
- hw/sd/bcm2835_sdhost.c       |   13 +-
- hw/sd/core.c                 |    2 +-
- hw/sd/milkymist-memcard.c    |    3 +-
- hw/sd/omap_mmc.c             |    6 +-
- hw/sd/pl181.c                |   11 +-
- hw/sd/sdhci.c                |   15 +-
- hw/sd/ssi-sd.c               |    6 +-
- linux-user/elfload.c         |    2 +
- target/arm/cpu.c             |   36 +-
- target/arm/cpu64.c           |   13 +-
- target/arm/helper.c          |   44 +-
- target/arm/kvm32.c           |   27 +-
- target/arm/sve_helper.c      | 1875 +++++++++++++++++++++++++++++++++++++++++-
- target/arm/translate-a64.c   |   62 +-
- target/arm/translate-sve.c   | 1688 ++++++++++++++++++++++++++++++++++++-
- target/arm/translate.c       |  102 ++-
- target/arm/vec_helper.c      |  311 ++++++-
- hw/sd/trace-events           |    2 +-
- target/arm/sve.decode        |  427 ++++++++++
-files changed, 5394 insertions(+), 257 deletions(-)

-[Qemu-devel] [PULL 01/55] hw/block/fdc: Replace error_setg(&error_abort) by assert()
+Deleted patch
-From: Philippe Mathieu-Daudé <f4bug@amsat.org>
-Use assert() instead of error_setg(&error_abort),
-as suggested by the "qapi/error.h" documentation:
-    Please don't error_setg(&error_fatal, ...), use error_report() and
-    exit(), because that's more obvious.
-    Likewise, don't error_setg(&error_abort, ...), use assert().
-Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
-Acked-by: John Snow <jsnow@redhat.com>
-Message-id: 20180625165749.3910-2-f4bug@amsat.org
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
----
- hw/block/fdc.c | 9 +--------
-file changed, 1 insertion(+), 8 deletions(-)
-diff --git a/hw/block/fdc.c b/hw/block/fdc.c
-index XXXXXXX..XXXXXXX 100644
---- a/hw/block/fdc.c
-+++ b/hw/block/fdc.c
-@@ -XXX,XX +XXX,XX @@ static int pick_geometry(FDrive *drv)
-                            nb_sectors,
-                            FloppyDriveType_str(parse->drive));
-         }
-+        assert(type_match != -1 && "misconfigured fd_format");
-         match = type_match;
-     }
--
--    /* No match of any kind found -- fd_format is misconfigured, abort. */
--    if (match == -1) {
--        error_setg(&error_abort, "No candidate geometries present in table "
--                   " for floppy drive type '%s'",
--                   FloppyDriveType_str(drv->drive));
--    }
--
-     parse = &(fd_formats[match]);
-  out:
---
-.17.1

-[Qemu-devel] [PULL 02/55] hw/arm/sysbus-fdt: Replace error_setg(&error_fatal) by error_report() + exit()
+Deleted patch
-From: Philippe Mathieu-Daudé <f4bug@amsat.org>
-Use error_report() + exit() instead of error_setg(&error_fatal),
-as suggested by the "qapi/error.h" documentation:
-   Please don't error_setg(&error_fatal, ...), use error_report() and
-   exit(), because that's more obvious.
-This fixes CID 1352173:
-    "Passing null pointer dt_name to qemu_fdt_node_path, which dereferences it."
-And this also fixes:
-    hw/arm/sysbus-fdt.c:322:9: warning: Array access (from variable 'node_path') results in a null pointer dereference
-        if (node_path[1]) {
-            ^~~~~~~~~~~~
-Fixes: Coverity CID 1352173 (Dereference after null check)
-Suggested-by: Eric Blake <eblake@redhat.com>
-Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
-Reviewed-by: Eric Auger <eric.auger@redhat.com>
-Message-id: 20180625165749.3910-3-f4bug@amsat.org
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
----
- hw/arm/sysbus-fdt.c | 53 +++++++++++++++++++++++++--------------------
-file changed, 30 insertions(+), 23 deletions(-)
-diff --git a/hw/arm/sysbus-fdt.c b/hw/arm/sysbus-fdt.c
-index XXXXXXX..XXXXXXX 100644
---- a/hw/arm/sysbus-fdt.c
-+++ b/hw/arm/sysbus-fdt.c
-@@ -XXX,XX +XXX,XX @@ static void copy_properties_from_host(HostProperty *props, int nb_props,
-         r = qemu_fdt_getprop(host_fdt, node_path,
-                              props[i].name,
-                              &prop_len,
--                             props[i].optional ? &err : &error_fatal);
-+                             &err);
-         if (r) {
-             qemu_fdt_setprop(guest_fdt, nodename,
-                              props[i].name, r, prop_len);
-         } else {
--            if (prop_len != -FDT_ERR_NOTFOUND) {
--                /* optional property not returned although property exists */
--                error_report_err(err);
--            } else {
-+            if (props[i].optional && prop_len == -FDT_ERR_NOTFOUND) {
-+                /* optional property does not exist */
-                 error_free(err);
-+            } else {
-+                error_report_err(err);
-+            }
-+            if (!props[i].optional) {
-+                /* mandatory property not found: bail out */
-+                exit(1);
-             }
-         }
-     }
-@@ -XXX,XX +XXX,XX @@ static void fdt_build_clock_node(void *host_fdt, void *guest_fdt,
-     node_offset = fdt_node_offset_by_phandle(host_fdt, host_phandle);
-     if (node_offset <= 0) {
--        error_setg(&error_fatal,
--                   "not able to locate clock handle %d in host device tree",
--                   host_phandle);
-+        error_report("not able to locate clock handle %d in host device tree",
-+                     host_phandle);
-+        exit(1);
-     }
-     node_path = g_malloc(path_len);
-     while ((ret = fdt_get_path(host_fdt, node_offset, node_path, path_len))
-@@ -XXX,XX +XXX,XX @@ static void fdt_build_clock_node(void *host_fdt, void *guest_fdt,
-         node_path = g_realloc(node_path, path_len);
-     }
-     if (ret < 0) {
--        error_setg(&error_fatal,
--                   "not able to retrieve node path for clock handle %d",
--                   host_phandle);
-+        error_report("not able to retrieve node path for clock handle %d",
-+                     host_phandle);
-+        exit(1);
-     }
-     r = qemu_fdt_getprop(host_fdt, node_path, "compatible", &prop_len,
-                          &error_fatal);
-     if (strcmp(r, "fixed-clock")) {
--        error_setg(&error_fatal,
--                   "clock handle %d is not a fixed clock", host_phandle);
-+        error_report("clock handle %d is not a fixed clock", host_phandle);
-+        exit(1);
-     }
-     nodename = strrchr(node_path, '/');
-@@ -XXX,XX +XXX,XX @@ static int add_amd_xgbe_fdt_node(SysBusDevice *sbdev, void *opaque)
-     dt_name = sysfs_to_dt_name(vbasedev->name);
-     if (!dt_name) {
--        error_setg(&error_fatal, "%s incorrect sysfs device name %s",
--                    __func__, vbasedev->name);
-+        error_report("%s incorrect sysfs device name %s",
-+                     __func__, vbasedev->name);
-+        exit(1);
-     }
-     node_path = qemu_fdt_node_path(host_fdt, dt_name, vdev->compat,
-                                    &error_fatal);
-     if (!node_path || !node_path[0]) {
--        error_setg(&error_fatal, "%s unable to retrieve node path for %s/%s",
--                   __func__, dt_name, vdev->compat);
-+        error_report("%s unable to retrieve node path for %s/%s",
-+                     __func__, dt_name, vdev->compat);
-+        exit(1);
-     }
-     if (node_path[1]) {
--        error_setg(&error_fatal, "%s more than one node matching %s/%s!",
--                   __func__, dt_name, vdev->compat);
-+        error_report("%s more than one node matching %s/%s!",
-+                     __func__, dt_name, vdev->compat);
-+        exit(1);
-     }
-     g_free(dt_name);
-     if (vbasedev->num_regions != 5) {
--        error_setg(&error_fatal, "%s Does the host dt node combine XGBE/PHY?",
--                   __func__);
-+        error_report("%s Does the host dt node combine XGBE/PHY?", __func__);
-+        exit(1);
-     }
-     /* generate nodes for DMA_CLK and PTP_CLK */
-     r = qemu_fdt_getprop(host_fdt, node_path[0], "clocks",
-                          &prop_len, &error_fatal);
-     if (prop_len != 8) {
--        error_setg(&error_fatal, "%s clocks property should contain 2 handles",
--                   __func__);
-+        error_report("%s clocks property should contain 2 handles", __func__);
-+        exit(1);
-     }
-     host_clock_phandles = (uint32_t *)r;
-     guest_clock_phandles[0] = qemu_fdt_alloc_phandle(guest_fdt);
---
-.17.1

-[Qemu-devel] [PULL 03/55] device_tree: Replace error_setg(&error_fatal) by error_report() + exit()
+Deleted patch
-From: Philippe Mathieu-Daudé <f4bug@amsat.org>
-Use error_report() + exit() instead of error_setg(&error_fatal),
-as suggested by the "qapi/error.h" documentation:
-   Please don't error_setg(&error_fatal, ...), use error_report() and
-   exit(), because that's more obvious.
-Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
-Reviewed-by: Eric Auger <eric.auger@redhat.com>
-Reviewed-by: Markus Armbruster <armbru@redhat.com>
-Reviewed-by: David Gibson <david@gibson.dropbear.id.au>
-Message-id: 20180625165749.3910-4-f4bug@amsat.org
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
----
- device_tree.c | 23 +++++++++++++----------
-file changed, 13 insertions(+), 10 deletions(-)
-diff --git a/device_tree.c b/device_tree.c
-index XXXXXXX..XXXXXXX 100644
---- a/device_tree.c
-+++ b/device_tree.c
-@@ -XXX,XX +XXX,XX @@ static void read_fstree(void *fdt, const char *dirname)
-     const char *parent_node;
-     if (strstr(dirname, root_dir) != dirname) {
--        error_setg(&error_fatal, "%s: %s must be searched within %s",
--                   __func__, dirname, root_dir);
-+        error_report("%s: %s must be searched within %s",
-+                     __func__, dirname, root_dir);
-+        exit(1);
-     }
-     parent_node = &dirname[strlen(SYSFS_DT_BASEDIR)];
-     d = opendir(dirname);
-     if (!d) {
--        error_setg(&error_fatal, "%s cannot open %s", __func__, dirname);
--        return;
-+        error_report("%s cannot open %s", __func__, dirname);
-+        exit(1);
-     }
-     while ((de = readdir(d)) != NULL) {
-@@ -XXX,XX +XXX,XX @@ static void read_fstree(void *fdt, const char *dirname)
-         tmpnam = g_strdup_printf("%s/%s", dirname, de->d_name);
-         if (lstat(tmpnam, &st) < 0) {
--            error_setg(&error_fatal, "%s cannot lstat %s", __func__, tmpnam);
-+            error_report("%s cannot lstat %s", __func__, tmpnam);
-+            exit(1);
-         }
-         if (S_ISREG(st.st_mode)) {
-@@ -XXX,XX +XXX,XX @@ static void read_fstree(void *fdt, const char *dirname)
-             gsize len;
-             if (!g_file_get_contents(tmpnam, &val, &len, NULL)) {
--                error_setg(&error_fatal, "%s not able to extract info from %s",
--                           __func__, tmpnam);
-+                error_report("%s not able to extract info from %s",
-+                             __func__, tmpnam);
-+                exit(1);
-             }
-             if (strlen(parent_node) > 0) {
-@@ -XXX,XX +XXX,XX @@ void *load_device_tree_from_sysfs(void)
-     host_fdt = create_device_tree(&host_fdt_size);
-     read_fstree(host_fdt, SYSFS_DT_BASEDIR);
-     if (fdt_check_header(host_fdt)) {
--        error_setg(&error_fatal,
--                   "%s host device tree extracted into memory is invalid",
--                   __func__);
-+        error_report("%s host device tree extracted into memory is invalid",
-+                     __func__);
-+        exit(1);
-     }
-     return host_fdt;
- }
---
-.17.1

-[Qemu-devel] [PULL 05/55] hw/arm/virt: Silence dtc /intc warnings
+[Qemu-devel] [PULL 01/42] hw/arm/smmuv3: Remove SMMUNotifierNode
 From: Eric Auger <eric.auger@redhat.com>
-When running dtc on the guest /proc/device-tree we get the
+The SMMUNotifierNode struct is not necessary and brings extra
-following warnings: "Warning (unit_address_vs_reg): Node <name>
+complexity so let's remove it. We now directly track the SMMUDevices
-has a reg or ranges property, but no unit name", with name:
+which have registered IOMMU MR notifiers.
 /intc, /intc/its, /intc/v2m.
-Nodes should have a name in the form <name>[@<unit-address>] where
+This is inspired from the same transformation on intel-iommu
-unit-address is the primary address used to access the device, listed
+done in commit b4a4ba0d68f50f218ee3957b6638dbee32a5eeef
-in the node's reg property. This fix seems to make dtc happy.
+("intel-iommu: remove IntelIOMMUNotifierNode")
 Signed-off-by: Eric Auger <eric.auger@redhat.com>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Peter Xu <peterx@redhat.com>
-Message-id: 1530044492-24921-3-git-send-email-eric.auger@redhat.com
+Message-id: 20190409160219.19026-1-eric.auger@redhat.com
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- hw/arm/virt.c | 63 +++++++++++++++++++++++++++++++--------------------
+ include/hw/arm/smmu-common.h |  8 ++------
-file changed, 39 insertions(+), 24 deletions(-)
+ hw/arm/smmu-common.c         |  6 +++---
  hw/arm/smmuv3.c              | 28 +++++++---------------------
 files changed, 12 insertions(+), 30 deletions(-)
-diff --git a/hw/arm/virt.c b/hw/arm/virt.c
+diff --git a/include/hw/arm/smmu-common.h b/include/hw/arm/smmu-common.h
 index XXXXXXX..XXXXXXX 100644
---- a/hw/arm/virt.c
+--- a/include/hw/arm/smmu-common.h
-+++ b/hw/arm/virt.c
++++ b/include/hw/arm/smmu-common.h
-@@ -XXX,XX +XXX,XX @@ static void fdt_add_cpu_nodes(const VirtMachineState *vms)
+@@ -XXX,XX +XXX,XX @@ typedef struct SMMUDevice {
+     AddressSpace       as;
- static void fdt_add_its_gic_node(VirtMachineState *vms)
+     uint32_t           cfg_cache_hits;
      uint32_t           cfg_cache_misses;
 +    QLIST_ENTRY(SMMUDevice) next;
  } SMMUDevice;
 -typedef struct SMMUNotifierNode {
 -    SMMUDevice *sdev;
 -    QLIST_ENTRY(SMMUNotifierNode) next;
 -} SMMUNotifierNode;
 -
  typedef struct SMMUPciBus {
      PCIBus       *bus;
      SMMUDevice   *pbdev[0]; /* Parent array is sparse, so dynamically alloc */
@@ -XXX,XX +XXX,XX @@ typedef struct SMMUState {
      GHashTable *iotlb;
      SMMUPciBus *smmu_pcibus_by_bus_num[SMMU_PCI_BUS_MAX];
      PCIBus *pci_bus;
 -    QLIST_HEAD(, SMMUNotifierNode) notifiers_list;
 +    QLIST_HEAD(, SMMUDevice) devices_with_notifiers;
      uint8_t bus_num;
      PCIBus *primary_bus;
  } SMMUState;
 diff --git a/hw/arm/smmu-common.c b/hw/arm/smmu-common.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/arm/smmu-common.c
 +++ b/hw/arm/smmu-common.c
@@ -XXX,XX +XXX,XX @@ inline void smmu_inv_notifiers_mr(IOMMUMemoryRegion *mr)
  /* Unmap all notifiers of all mr's */
  void smmu_inv_notifiers_all(SMMUState *s)
  {
-+    char *nodename;
+-    SMMUNotifierNode *node;
-+
++    SMMUDevice *sdev;
-     vms->msi_phandle = qemu_fdt_alloc_phandle(vms->fdt);
--    qemu_fdt_add_subnode(vms->fdt, "/intc/its");
+-    QLIST_FOREACH(node, &s->notifiers_list, next) {
--    qemu_fdt_setprop_string(vms->fdt, "/intc/its", "compatible",
+-        smmu_inv_notifiers_mr(&node->sdev->iommu);
-+    nodename = g_strdup_printf("/intc/its@%" PRIx64,
++    QLIST_FOREACH(sdev, &s->devices_with_notifiers, next) {
-+                               vms->memmap[VIRT_GIC_ITS].base);
++        smmu_inv_notifiers_mr(&sdev->iommu);
-+    qemu_fdt_add_subnode(vms->fdt, nodename);
+     }
 +    qemu_fdt_setprop_string(vms->fdt, nodename, "compatible",
                              "arm,gic-v3-its");
 -    qemu_fdt_setprop(vms->fdt, "/intc/its", "msi-controller", NULL, 0);
 -    qemu_fdt_setprop_sized_cells(vms->fdt, "/intc/its", "reg",
 +    qemu_fdt_setprop(vms->fdt, nodename, "msi-controller", NULL, 0);
 +    qemu_fdt_setprop_sized_cells(vms->fdt, nodename, "reg",
 , vms->memmap[VIRT_GIC_ITS].base,
 , vms->memmap[VIRT_GIC_ITS].size);
 -    qemu_fdt_setprop_cell(vms->fdt, "/intc/its", "phandle", vms->msi_phandle);
 +    qemu_fdt_setprop_cell(vms->fdt, nodename, "phandle", vms->msi_phandle);
 +    g_free(nodename);
  }
- static void fdt_add_v2m_gic_node(VirtMachineState *vms)
+diff --git a/hw/arm/smmuv3.c b/hw/arm/smmuv3.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/arm/smmuv3.c
 +++ b/hw/arm/smmuv3.c
@@ -XXX,XX +XXX,XX @@ static void smmuv3_notify_iova(IOMMUMemoryRegion *mr,
  /* invalidate an asid/iova tuple in all mr's */
  static void smmuv3_inv_notifiers_iova(SMMUState *s, int asid, dma_addr_t iova)
  {
-+    char *nodename;
+-    SMMUNotifierNode *node;
-+
++    SMMUDevice *sdev;
-+    nodename = g_strdup_printf("/intc/v2m@%" PRIx64,
-+                               vms->memmap[VIRT_GIC_V2M].base);
+-    QLIST_FOREACH(node, &s->notifiers_list, next) {
-     vms->msi_phandle = qemu_fdt_alloc_phandle(vms->fdt);
+-        IOMMUMemoryRegion *mr = &node->sdev->iommu;
--    qemu_fdt_add_subnode(vms->fdt, "/intc/v2m");
++    QLIST_FOREACH(sdev, &s->devices_with_notifiers, next) {
--    qemu_fdt_setprop_string(vms->fdt, "/intc/v2m", "compatible",
++        IOMMUMemoryRegion *mr = &sdev->iommu;
-+    qemu_fdt_add_subnode(vms->fdt, nodename);
+         IOMMUNotifier *n;
-+    qemu_fdt_setprop_string(vms->fdt, nodename, "compatible",
-                             "arm,gic-v2m-frame");
+         trace_smmuv3_inv_notifiers_iova(mr->parent_obj.name, asid, iova);
--    qemu_fdt_setprop(vms->fdt, "/intc/v2m", "msi-controller", NULL, 0);
+@@ -XXX,XX +XXX,XX @@ static void smmuv3_notify_flag_changed(IOMMUMemoryRegion *iommu,
--    qemu_fdt_setprop_sized_cells(vms->fdt, "/intc/v2m", "reg",
+     SMMUDevice *sdev = container_of(iommu, SMMUDevice, iommu);
-+    qemu_fdt_setprop(vms->fdt, nodename, "msi-controller", NULL, 0);
+     SMMUv3State *s3 = sdev->smmu;
-+    qemu_fdt_setprop_sized_cells(vms->fdt, nodename, "reg",
+     SMMUState *s = &(s3->smmu_state);
-, vms->memmap[VIRT_GIC_V2M].base,
+-    SMMUNotifierNode *node = NULL;
-, vms->memmap[VIRT_GIC_V2M].size);
+-    SMMUNotifierNode *next_node = NULL;
--    qemu_fdt_setprop_cell(vms->fdt, "/intc/v2m", "phandle", vms->msi_phandle);
-+    qemu_fdt_setprop_cell(vms->fdt, nodename, "phandle", vms->msi_phandle);
+     if (new & IOMMU_NOTIFIER_MAP) {
-+    g_free(nodename);
+         int bus_num = pci_bus_num(sdev->bus);
@@ -XXX,XX +XXX,XX @@ static void smmuv3_notify_flag_changed(IOMMUMemoryRegion *iommu,
      if (old == IOMMU_NOTIFIER_NONE) {
          trace_smmuv3_notify_flag_add(iommu->parent_obj.name);
 -        node = g_malloc0(sizeof(*node));
 -        node->sdev = sdev;
 -        QLIST_INSERT_HEAD(&s->notifiers_list, node, next);
 -        return;
 -    }
 -
 -    /* update notifier node with new flags */
 -    QLIST_FOREACH_SAFE(node, &s->notifiers_list, next, next_node) {
 -        if (node->sdev == sdev) {
 -            if (new == IOMMU_NOTIFIER_NONE) {
 -                trace_smmuv3_notify_flag_del(iommu->parent_obj.name);
 -                QLIST_REMOVE(node, next);
 -                g_free(node);
 -            }
 -            return;
 -        }
 +        QLIST_INSERT_HEAD(&s->devices_with_notifiers, sdev, next);
 +    } else if (new == IOMMU_NOTIFIER_NONE) {
 +        trace_smmuv3_notify_flag_del(iommu->parent_obj.name);
 +        QLIST_REMOVE(sdev, next);
      }
  }
- static void fdt_add_gic_node(VirtMachineState *vms)
- {
-+    char *nodename;
-+
-     vms->gic_phandle = qemu_fdt_alloc_phandle(vms->fdt);
-     qemu_fdt_setprop_cell(vms->fdt, "/", "interrupt-parent", vms->gic_phandle);
--    qemu_fdt_add_subnode(vms->fdt, "/intc");
--    qemu_fdt_setprop_cell(vms->fdt, "/intc", "#interrupt-cells", 3);
--    qemu_fdt_setprop(vms->fdt, "/intc", "interrupt-controller", NULL, 0);
--    qemu_fdt_setprop_cell(vms->fdt, "/intc", "#address-cells", 0x2);
--    qemu_fdt_setprop_cell(vms->fdt, "/intc", "#size-cells", 0x2);
--    qemu_fdt_setprop(vms->fdt, "/intc", "ranges", NULL, 0);
-+    nodename = g_strdup_printf("/intc@%" PRIx64,
-+                               vms->memmap[VIRT_GIC_DIST].base);
-+    qemu_fdt_add_subnode(vms->fdt, nodename);
-+    qemu_fdt_setprop_cell(vms->fdt, nodename, "#interrupt-cells", 3);
-+    qemu_fdt_setprop(vms->fdt, nodename, "interrupt-controller", NULL, 0);
-+    qemu_fdt_setprop_cell(vms->fdt, nodename, "#address-cells", 0x2);
-+    qemu_fdt_setprop_cell(vms->fdt, nodename, "#size-cells", 0x2);
-+    qemu_fdt_setprop(vms->fdt, nodename, "ranges", NULL, 0);
-     if (vms->gic_version == 3) {
-         int nb_redist_regions = virt_gicv3_redist_region_count(vms);
--        qemu_fdt_setprop_string(vms->fdt, "/intc", "compatible",
-+        qemu_fdt_setprop_string(vms->fdt, nodename, "compatible",
-                                 "arm,gic-v3");
--        qemu_fdt_setprop_cell(vms->fdt, "/intc",
-+        qemu_fdt_setprop_cell(vms->fdt, nodename,
-                               "#redistributor-regions", nb_redist_regions);
-         if (nb_redist_regions == 1) {
--            qemu_fdt_setprop_sized_cells(vms->fdt, "/intc", "reg",
-+            qemu_fdt_setprop_sized_cells(vms->fdt, nodename, "reg",
-, vms->memmap[VIRT_GIC_DIST].base,
-, vms->memmap[VIRT_GIC_DIST].size,
-, vms->memmap[VIRT_GIC_REDIST].base,
-, vms->memmap[VIRT_GIC_REDIST].size);
-         } else {
--            qemu_fdt_setprop_sized_cells(vms->fdt, "/intc", "reg",
-+            qemu_fdt_setprop_sized_cells(vms->fdt, nodename, "reg",
-, vms->memmap[VIRT_GIC_DIST].base,
-, vms->memmap[VIRT_GIC_DIST].size,
-, vms->memmap[VIRT_GIC_REDIST].base,
-@@ -XXX,XX +XXX,XX @@ static void fdt_add_gic_node(VirtMachineState *vms)
-         }
-         if (vms->virt) {
--            qemu_fdt_setprop_cells(vms->fdt, "/intc", "interrupts",
-+            qemu_fdt_setprop_cells(vms->fdt, nodename, "interrupts",
-                                    GIC_FDT_IRQ_TYPE_PPI, ARCH_GICV3_MAINT_IRQ,
-                                    GIC_FDT_IRQ_FLAGS_LEVEL_HI);
-         }
-     } else {
-         /* 'cortex-a15-gic' means 'GIC v2' */
--        qemu_fdt_setprop_string(vms->fdt, "/intc", "compatible",
-+        qemu_fdt_setprop_string(vms->fdt, nodename, "compatible",
-                                 "arm,cortex-a15-gic");
--        qemu_fdt_setprop_sized_cells(vms->fdt, "/intc", "reg",
-+        qemu_fdt_setprop_sized_cells(vms->fdt, nodename, "reg",
-, vms->memmap[VIRT_GIC_DIST].base,
-, vms->memmap[VIRT_GIC_DIST].size,
-, vms->memmap[VIRT_GIC_CPU].base,
-, vms->memmap[VIRT_GIC_CPU].size);
-     }
--    qemu_fdt_setprop_cell(vms->fdt, "/intc", "phandle", vms->gic_phandle);
-+    qemu_fdt_setprop_cell(vms->fdt, nodename, "phandle", vms->gic_phandle);
-+    g_free(nodename);
- }
- static void fdt_add_pmu_nodes(const VirtMachineState *vms)
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 49/55] sd: Don't trace SDRequest crc field
+[Qemu-devel] [PULL 02/42] hw/ssi/xilinx_spips: Avoid variable length array
-We don't actually implement SD command CRC checking, because
+In the stripe8() function we use a variable length array; however
-for almost all of our SD controllers the CRC generation is
+we know that the maximum length required is MAX_NUM_BUSSES. Use
-done in hardware, and so modelling CRC generation and checking
+a fixed-length array and an assert instead.
 would be a bit pointless. (The exception is that milkymist-memcard
 makes the guest software compute the CRC.)
 As a result almost all of our SD controller models don't bother
 to set the SDRequest crc field, and the SD card model doesn't
 check it. So the tracing of it in sdbus_do_command() provokes
 Coverity warnings about use of uninitialized data.
 Drop the CRC field from the trace; we can always add it back
 if and when we do anything useful with the CRC.
 Fixes Coverity issues 1386072, 1386074, 1386076, 1390571.
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
-Message-id: 20180626180324.5537-1-peter.maydell@linaro.org
+Reviewed-by: Francisco Iglesias <frasse.iglesias@gmail.com>
 Reviewed-by: Alistair Francis <alistair.francis@wdc.com>
 Reviewed-by: Stefano Garzarella <sgarzare@redhat.com>
 Message-id: 20190328152635.2794-1-peter.maydell@linaro.org
 ---
- hw/sd/core.c       | 2 +-
+ hw/ssi/xilinx_spips.c | 6 ++++--
- hw/sd/trace-events | 2 +-
+file changed, 4 insertions(+), 2 deletions(-)
 files changed, 2 insertions(+), 2 deletions(-)
-diff --git a/hw/sd/core.c b/hw/sd/core.c
+diff --git a/hw/ssi/xilinx_spips.c b/hw/ssi/xilinx_spips.c
 index XXXXXXX..XXXXXXX 100644
---- a/hw/sd/core.c
+--- a/hw/ssi/xilinx_spips.c
-+++ b/hw/sd/core.c
++++ b/hw/ssi/xilinx_spips.c
-@@ -XXX,XX +XXX,XX @@ int sdbus_do_command(SDBus *sdbus, SDRequest *req, uint8_t *response)
+@@ -XXX,XX +XXX,XX @@ static void xlnx_zynqmp_qspips_reset(DeviceState *d)
  static inline void stripe8(uint8_t *x, int num, bool dir)
  {
-     SDState *card = get_card(sdbus);
+-    uint8_t r[num];
+-    memset(r, 0, sizeof(uint8_t) * num);
--    trace_sdbus_command(sdbus_name(sdbus), req->cmd, req->arg, req->crc);
++    uint8_t r[MAX_NUM_BUSSES];
-+    trace_sdbus_command(sdbus_name(sdbus), req->cmd, req->arg);
+     int idx[2] = {0, 0};
-     if (card) {
+     int bit[2] = {0, 7};
-         SDCardClass *sc = SD_CARD_GET_CLASS(card);
+     int d = dir;
-diff --git a/hw/sd/trace-events b/hw/sd/trace-events
++    assert(num <= MAX_NUM_BUSSES);
-index XXXXXXX..XXXXXXX 100644
++    memset(r, 0, sizeof(uint8_t) * num);
---- a/hw/sd/trace-events
++
-+++ b/hw/sd/trace-events
+     for (idx[0] = 0; idx[0] < num; ++idx[0]) {
-@@ -XXX,XX +XXX,XX @@ bcm2835_sdhost_edm_change(const char *why, uint32_t edm) "(%s) EDM now 0x%x"
+         for (bit[0] = 7; bit[0] >= 0; bit[0]--) {
- bcm2835_sdhost_update_irq(uint32_t irq) "IRQ bits 0x%x\n"
+             r[idx[!d]] |= x[idx[d]] & 1 << bit[d] ? 1 << bit[!d] : 0;
  # hw/sd/core.c
 -sdbus_command(const char *bus_name, uint8_t cmd, uint32_t arg, uint8_t crc) "@%s CMD%02d arg 0x%08x crc 0x%02x"
 +sdbus_command(const char *bus_name, uint8_t cmd, uint32_t arg) "@%s CMD%02d arg 0x%08x"
  sdbus_read(const char *bus_name, uint8_t value) "@%s value 0x%02x"
  sdbus_write(const char *bus_name, uint8_t value) "@%s value 0x%02x"
  sdbus_set_voltage(const char *bus_name, uint16_t millivolts) "@%s %u (mV)"
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 53/55] target/arm: Prune a57 features from max
+[Qemu-devel] [PULL 03/42] configure: Remove --source-path option
-From: Richard Henderson <richard.henderson@linaro.org>
+Normally configure identifies the source path by looking
 at the location where the configure script itself exists.
 We also provide a --source-path option which lets the user
 manually override this.
-There is no need to re-set these 9 features already
+There isn't really an obvious use case for the --source-path
-implied by the call to aarch64_a57_initfn.
+option, and in commit 927128222b0a91f56c13a in 2017 we
 accidentally added some logic that looks at $source_path
 before the command line option that overrides it has been
 processed.
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+The fact that nobody complained suggests that there isn't
-Reviewed-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
+any use of this option and we aren't testing it either;
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+remove it. This allows us to move the "make $source_path
-Message-id: 20180629001538.11415-4-richard.henderson@linaro.org
+absolute" logic up so that there is no window in the script
 where $source_path is set but not yet absolute.
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Daniel P. Berrangé <berrange@redhat.com>
+Message-id: 20190318134019.23729-1-peter.maydell@linaro.org
 ---
- target/arm/cpu64.c | 9 ---------
+ configure | 10 ++--------
-file changed, 9 deletions(-)
+file changed, 2 insertions(+), 8 deletions(-)
-diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
+diff --git a/configure b/configure
-index XXXXXXX..XXXXXXX 100644
+index XXXXXXX..XXXXXXX 100755
---- a/target/arm/cpu64.c
+--- a/configure
-+++ b/target/arm/cpu64.c
++++ b/configure
-@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
+@@ -XXX,XX +XXX,XX @@ ld_has() {
-          * whereas the architecture requires them to be present in both if
-          * present in either.
+ # default parameters
-          */
+ source_path=$(dirname "$0")
--        set_feature(&cpu->env, ARM_FEATURE_V8);
++# make source path absolute
--        set_feature(&cpu->env, ARM_FEATURE_VFP4);
++source_path=$(cd "$source_path"; pwd)
--        set_feature(&cpu->env, ARM_FEATURE_NEON);
+ cpu=""
--        set_feature(&cpu->env, ARM_FEATURE_AARCH64);
+ iasl="iasl"
--        set_feature(&cpu->env, ARM_FEATURE_V8_AES);
+ interp_prefix="/usr/gnemul/qemu-%M"
--        set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
+@@ -XXX,XX +XXX,XX @@ for opt do
--        set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
+   ;;
-         set_feature(&cpu->env, ARM_FEATURE_V8_SHA512);
+   --cxx=*) CXX="$optarg"
-         set_feature(&cpu->env, ARM_FEATURE_V8_SHA3);
+   ;;
-         set_feature(&cpu->env, ARM_FEATURE_V8_SM3);
+-  --source-path=*) source_path="$optarg"
-         set_feature(&cpu->env, ARM_FEATURE_V8_SM4);
+-  ;;
--        set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
+   --cpu=*) cpu="$optarg"
--        set_feature(&cpu->env, ARM_FEATURE_CRC);
+   ;;
-         set_feature(&cpu->env, ARM_FEATURE_V8_ATOMICS);
+   --extra-cflags=*) QEMU_CFLAGS="$QEMU_CFLAGS $optarg"
-         set_feature(&cpu->env, ARM_FEATURE_V8_RDM);
+@@ -XXX,XX +XXX,XX @@ if test "$debug_info" = "yes"; then
-         set_feature(&cpu->env, ARM_FEATURE_V8_DOTPROD);
+     LDFLAGS="-g $LDFLAGS"
  fi
 -# make source path absolute
 -source_path=$(cd "$source_path"; pwd)
 -
  # running configure in the source tree?
  # we know that's the case if configure is there.
  if test -f "./configure"; then
@@ -XXX,XX +XXX,XX @@ for opt do
    ;;
    --interp-prefix=*) interp_prefix="$optarg"
    ;;
 -  --source-path=*)
 -  ;;
    --cross-prefix=*)
    ;;
    --cc=*)
@@ -XXX,XX +XXX,XX @@ $(echo Available targets: $default_target_list | \
    --target-list-exclude=LIST exclude a set of targets from the default target-list
  Advanced options (experts only):
 -  --source-path=PATH       path of source code [$source_path]
    --cross-prefix=PREFIX    use PREFIX for compile tools [$cross_prefix]
    --cc=CC                  use C compiler CC [$cc]
    --iasl=IASL              use ACPI compiler IASL [$iasl]
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 06/55] hw/arm/virt: Silence dtc /memory warning
+[Qemu-devel] [PULL 04/42] target/arm: Make sure M-profile FPSCR RES0 bits are not settable
-From: Eric Auger <eric.auger@redhat.com>
+Enforce that for M-profile various FPSCR bits which are RES0 there
 but have defined meanings on A-profile are never settable. This
 ensures that M-profile code can't enable the A-profile behaviour
 (notably vector length/stride handling) by accident.
-When running dtc on the guest /proc/device-tree we get the
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-following warning: Warning (unit_address_vs_reg): Node /memory
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-has a reg or ranges property, but no unit name".
+Message-id: 20190416125744.27770-2-peter.maydell@linaro.org
 ---
  target/arm/vfp_helper.c | 8 ++++++++
 file changed, 8 insertions(+)
-Let's fix that by adding the unit address to the node name. We also
+diff --git a/target/arm/vfp_helper.c b/target/arm/vfp_helper.c
 don't create the /memory node anymore in create_fdt(). We directly
 create it in load_dtb. /chosen still needs to be created in create_fdt
 as the uart needs it. In case the user provided his own dtb, we nop
 all memory nodes found in root and create new one(s).
 Signed-off-by: Eric Auger <eric.auger@redhat.com>
 Message-id: 1530044492-24921-4-git-send-email-eric.auger@redhat.com
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  hw/arm/boot.c | 41 +++++++++++++++++++++++------------------
  hw/arm/virt.c |  7 +------
 files changed, 24 insertions(+), 24 deletions(-)
 diff --git a/hw/arm/boot.c b/hw/arm/boot.c
 index XXXXXXX..XXXXXXX 100644
---- a/hw/arm/boot.c
+--- a/target/arm/vfp_helper.c
-+++ b/hw/arm/boot.c
++++ b/target/arm/vfp_helper.c
-@@ -XXX,XX +XXX,XX @@ int arm_load_dtb(hwaddr addr, const struct arm_boot_info *binfo,
+@@ -XXX,XX +XXX,XX @@ void HELPER(vfp_set_fpscr)(CPUARMState *env, uint32_t val)
-                  hwaddr addr_limit, AddressSpace *as)
+         val &= ~FPCR_FZ16;
  {
      void *fdt = NULL;
 -    int size, rc;
 +    int size, rc, n = 0;
      uint32_t acells, scells;
      char *nodename;
      unsigned int i;
      hwaddr mem_base, mem_len;
 +    char **node_path;
 +    Error *err = NULL;
      if (binfo->dtb_filename) {
          char *filename;
@@ -XXX,XX +XXX,XX @@ int arm_load_dtb(hwaddr addr, const struct arm_boot_info *binfo,
          goto fail;
      }
-+    /* nop all root nodes matching /memory or /memory@unit-address */
++    if (arm_feature(env, ARM_FEATURE_M)) {
-+    node_path = qemu_fdt_node_unit_path(fdt, "memory", &err);
++        /*
-+    if (err) {
++         * M profile FPSCR is RES0 for the QC, STRIDE, FZ16, LEN bits
-+        error_report_err(err);
++         * and also for the trapped-exception-handling bits IxE.
-+        goto fail;
++         */
 +        val &= 0xf7c0009f;
 +    }
-+    while (node_path[n]) {
-+        if (g_str_has_prefix(node_path[n], "/memory")) {
-+            qemu_fdt_nop_node(fdt, node_path[n]);
-+        }
-+        n++;
-+    }
-+    g_strfreev(node_path);
 +
-     if (nb_numa_nodes > 0) {
+     /*
--        /*
+      * We don't implement trapped exception handling, so the
--         * Turn the /memory node created before into a NOP node, then create
+      * trap enable bits, IDE|IXE|UFE|OFE|DZE|IOE are all RAZ/WI (not RES0!)
 -         * /memory@addr nodes for all numa nodes respectively.
 -         */
 -        qemu_fdt_nop_node(fdt, "/memory");
          mem_base = binfo->loader_start;
          for (i = 0; i < nb_numa_nodes; i++) {
              mem_len = numa_info[i].node_mem;
@@ -XXX,XX +XXX,XX @@ int arm_load_dtb(hwaddr addr, const struct arm_boot_info *binfo,
              g_free(nodename);
          }
      } else {
 -        Error *err = NULL;
 +        nodename = g_strdup_printf("/memory@%" PRIx64, binfo->loader_start);
 +        qemu_fdt_add_subnode(fdt, nodename);
 +        qemu_fdt_setprop_string(fdt, nodename, "device_type", "memory");
 -        rc = fdt_path_offset(fdt, "/memory");
 -        if (rc < 0) {
 -            qemu_fdt_add_subnode(fdt, "/memory");
 -        }
 -
 -        if (!qemu_fdt_getprop(fdt, "/memory", "device_type", NULL, &err)) {
 -            qemu_fdt_setprop_string(fdt, "/memory", "device_type", "memory");
 -        }
 -
 -        rc = qemu_fdt_setprop_sized_cells(fdt, "/memory", "reg",
 +        rc = qemu_fdt_setprop_sized_cells(fdt, nodename, "reg",
                                            acells, binfo->loader_start,
                                            scells, binfo->ram_size);
          if (rc < 0) {
 -            fprintf(stderr, "couldn't set /memory/reg\n");
 +            fprintf(stderr, "couldn't set %s reg\n", nodename);
              goto fail;
          }
 +        g_free(nodename);
      }
      rc = fdt_path_offset(fdt, "/chosen");
 diff --git a/hw/arm/virt.c b/hw/arm/virt.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/arm/virt.c
 +++ b/hw/arm/virt.c
@@ -XXX,XX +XXX,XX @@ static void create_fdt(VirtMachineState *vms)
      qemu_fdt_setprop_cell(fdt, "/", "#address-cells", 0x2);
      qemu_fdt_setprop_cell(fdt, "/", "#size-cells", 0x2);
 -    /*
 -     * /chosen and /memory nodes must exist for load_dtb
 -     * to fill in necessary properties later
 -     */
 +    /* /chosen must exist for load_dtb to fill in necessary properties later */
      qemu_fdt_add_subnode(fdt, "/chosen");
 -    qemu_fdt_add_subnode(fdt, "/memory");
 -    qemu_fdt_setprop_string(fdt, "/memory", "device_type", "memory");
      /* Clock node, for the benefit of the UART. The kernel device tree
       * binding documentation claims the PL011 node clock properties are
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 51/55] target/arm: Fix SVE signed division vs x86 overflow exception
+[Qemu-devel] [PULL 05/42] hw/intc/armv7m_nvic: Allow reading of M-profile MVFR* registers
-From: Richard Henderson <richard.henderson@linaro.org>
+For M-profile the MVFR* ID registers are memory mapped, in the
 range we implement via the NVIC. Allow them to be read.
 (If the CPU has no FPU, these registers are defined to be RAZ.)
-We already check for the same condition within the normal integer
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-sdiv and sdiv64 helpers.  Use a slightly different formation that
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-does not require deducing the expression type.
+Message-id: 20190416125744.27770-3-peter.maydell@linaro.org
 ---
  hw/intc/armv7m_nvic.c | 6 ++++++
 file changed, 6 insertions(+)
-Fixes: f97cfd596ed
+diff --git a/hw/intc/armv7m_nvic.c b/hw/intc/armv7m_nvic.c
 Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Reviewed-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Message-id: 20180629001538.11415-2-richard.henderson@linaro.org
 [PMM: reworded a comment]
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/sve_helper.c | 20 +++++++++++++++-----
 file changed, 15 insertions(+), 5 deletions(-)
 diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve_helper.c
+--- a/hw/intc/armv7m_nvic.c
-+++ b/target/arm/sve_helper.c
++++ b/hw/intc/armv7m_nvic.c
-@@ -XXX,XX +XXX,XX @@ void HELPER(NAME)(void *vd, void *vn, void *vm, void *vg, uint32_t desc) \
+@@ -XXX,XX +XXX,XX @@ static uint32_t nvic_readl(NVICState *s, uint32_t offset, MemTxAttrs attrs)
- #define DO_MIN(N, M)  ((N) >= (M) ? (M) : (N))
+             return 0;
- #define DO_ABD(N, M)  ((N) >= (M) ? (N) - (M) : (M) - (N))
+         }
- #define DO_MUL(N, M)  (N * M)
+         return cpu->env.v7m.sfar;
--#define DO_DIV(N, M)  (M ? N / M : 0)
++    case 0xf40: /* MVFR0 */
-+
++        return cpu->isar.mvfr0;
-+
++    case 0xf44: /* MVFR1 */
-+/*
++        return cpu->isar.mvfr1;
-+ * We must avoid the C undefined behaviour cases: division by
++    case 0xf48: /* MVFR2 */
-+ * zero and signed division of INT_MIN by -1. Both of these
++        return cpu->isar.mvfr2;
-+ * have architecturally defined required results for Arm.
+     default:
-+ * We special case all signed divisions by -1 to avoid having
+     bad_offset:
-+ * to deduce the minimum integer for the type involved.
+         qemu_log_mask(LOG_GUEST_ERROR, "NVIC: Bad read offset 0x%x\n", offset);
 + */
 +#define DO_SDIV(N, M) (unlikely(M == 0) ? 0 : unlikely(M == -1) ? -N : N / M)
 +#define DO_UDIV(N, M) (unlikely(M == 0) ? 0 : N / M)
  DO_ZPZZ(sve_and_zpzz_b, uint8_t, H1, DO_AND)
  DO_ZPZZ(sve_and_zpzz_h, uint16_t, H1_2, DO_AND)
@@ -XXX,XX +XXX,XX @@ DO_ZPZZ(sve_umulh_zpzz_h, uint16_t, H1_2, do_mulh_h)
  DO_ZPZZ(sve_umulh_zpzz_s, uint32_t, H1_4, do_mulh_s)
  DO_ZPZZ_D(sve_umulh_zpzz_d, uint64_t, do_umulh_d)
 -DO_ZPZZ(sve_sdiv_zpzz_s, int32_t, H1_4, DO_DIV)
 -DO_ZPZZ_D(sve_sdiv_zpzz_d, int64_t, DO_DIV)
 +DO_ZPZZ(sve_sdiv_zpzz_s, int32_t, H1_4, DO_SDIV)
 +DO_ZPZZ_D(sve_sdiv_zpzz_d, int64_t, DO_SDIV)
 -DO_ZPZZ(sve_udiv_zpzz_s, uint32_t, H1_4, DO_DIV)
 -DO_ZPZZ_D(sve_udiv_zpzz_d, uint64_t, DO_DIV)
 +DO_ZPZZ(sve_udiv_zpzz_s, uint32_t, H1_4, DO_UDIV)
 +DO_ZPZZ_D(sve_udiv_zpzz_d, uint64_t, DO_UDIV)
  /* Note that all bits of the shift are significant
     and not modulo the element size.  */
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 40/55] target/arm: Enable SVE for aarch64-linux-user
+[Qemu-devel] [PULL 06/42] target/arm: Implement dummy versions of M-profile FP-related registers
-From: Richard Henderson <richard.henderson@linaro.org>
+The M-profile floating point support has three associated config
+registers: FPCAR, FPCCR and FPDSCR. It also makes the registers
-Enable ARM_FEATURE_SVE for the generic "max" cpu.
+CPACR and NSACR have behaviour other than reads-as-zero.
+Add support for all of these as simple reads-as-written registers.
-Tested-by: Alex Bennée <alex.bennee@linaro.org>
+We will hook up actual functionality later.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+The main complexity here is handling the FPCCR register, which
-Message-id: 20180627043328.11531-35-richard.henderson@linaro.org
+has a mix of banked and unbanked bits.
 Note that we don't share storage with the A-profile
 cpu->cp15.nsacr and cpu->cp15.cpacr_el1, though the behaviour
 is quite similar, for two reasons:
  * the M profile CPACR is banked between security states
  * it preserves the invariant that M profile uses no state
    inside the cp15 substruct
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-4-peter.maydell@linaro.org
 ---
- linux-user/elfload.c | 1 +
+ target/arm/cpu.h      |  34 ++++++++++++
- target/arm/cpu.c     | 7 +++++++
+ hw/intc/armv7m_nvic.c | 125 ++++++++++++++++++++++++++++++++++++++++++
- target/arm/cpu64.c   | 1 +
+ target/arm/cpu.c      |   5 ++
-files changed, 9 insertions(+)
+ target/arm/machine.c  |  16 ++++++
+files changed, 180 insertions(+)
-diff --git a/linux-user/elfload.c b/linux-user/elfload.c
-index XXXXXXX..XXXXXXX 100644
+diff --git a/target/arm/cpu.h b/target/arm/cpu.h
---- a/linux-user/elfload.c
+index XXXXXXX..XXXXXXX 100644
-+++ b/linux-user/elfload.c
+--- a/target/arm/cpu.h
-@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
++++ b/target/arm/cpu.h
-     GET_FEATURE(ARM_FEATURE_V8_ATOMICS, ARM_HWCAP_A64_ATOMICS);
+@@ -XXX,XX +XXX,XX @@ typedef struct CPUARMState {
-     GET_FEATURE(ARM_FEATURE_V8_RDM, ARM_HWCAP_A64_ASIMDRDM);
+         uint32_t scr[M_REG_NUM_BANKS];
-     GET_FEATURE(ARM_FEATURE_V8_FCMA, ARM_HWCAP_A64_FCMA);
+         uint32_t msplim[M_REG_NUM_BANKS];
-+    GET_FEATURE(ARM_FEATURE_SVE, ARM_HWCAP_A64_SVE);
+         uint32_t psplim[M_REG_NUM_BANKS];
- #undef GET_FEATURE
++        uint32_t fpcar[M_REG_NUM_BANKS];
++        uint32_t fpccr[M_REG_NUM_BANKS];
-     return hwcaps;
++        uint32_t fpdscr[M_REG_NUM_BANKS];
 +        uint32_t cpacr[M_REG_NUM_BANKS];
 +        uint32_t nsacr;
      } v7m;
      /* Information associated with an exception about to be taken:
@@ -XXX,XX +XXX,XX @@ FIELD(V7M_CSSELR, LEVEL, 1, 3)
   */
  FIELD(V7M_CSSELR, INDEX, 0, 4)
 +/* v7M FPCCR bits */
 +FIELD(V7M_FPCCR, LSPACT, 0, 1)
 +FIELD(V7M_FPCCR, USER, 1, 1)
 +FIELD(V7M_FPCCR, S, 2, 1)
 +FIELD(V7M_FPCCR, THREAD, 3, 1)
 +FIELD(V7M_FPCCR, HFRDY, 4, 1)
 +FIELD(V7M_FPCCR, MMRDY, 5, 1)
 +FIELD(V7M_FPCCR, BFRDY, 6, 1)
 +FIELD(V7M_FPCCR, SFRDY, 7, 1)
 +FIELD(V7M_FPCCR, MONRDY, 8, 1)
 +FIELD(V7M_FPCCR, SPLIMVIOL, 9, 1)
 +FIELD(V7M_FPCCR, UFRDY, 10, 1)
 +FIELD(V7M_FPCCR, RES0, 11, 15)
 +FIELD(V7M_FPCCR, TS, 26, 1)
 +FIELD(V7M_FPCCR, CLRONRETS, 27, 1)
 +FIELD(V7M_FPCCR, CLRONRET, 28, 1)
 +FIELD(V7M_FPCCR, LSPENS, 29, 1)
 +FIELD(V7M_FPCCR, LSPEN, 30, 1)
 +FIELD(V7M_FPCCR, ASPEN, 31, 1)
 +/* These bits are banked. Others are non-banked and live in the M_REG_S bank */
 +#define R_V7M_FPCCR_BANKED_MASK                 \
 +    (R_V7M_FPCCR_LSPACT_MASK |                  \
 +     R_V7M_FPCCR_USER_MASK |                    \
 +     R_V7M_FPCCR_THREAD_MASK |                  \
 +     R_V7M_FPCCR_MMRDY_MASK |                   \
 +     R_V7M_FPCCR_SPLIMVIOL_MASK |               \
 +     R_V7M_FPCCR_UFRDY_MASK |                   \
 +     R_V7M_FPCCR_ASPEN_MASK)
 +
  /*
   * System register ID fields.
   */
 diff --git a/hw/intc/armv7m_nvic.c b/hw/intc/armv7m_nvic.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/intc/armv7m_nvic.c
 +++ b/hw/intc/armv7m_nvic.c
@@ -XXX,XX +XXX,XX @@ static uint32_t nvic_readl(NVICState *s, uint32_t offset, MemTxAttrs attrs)
      }
      case 0xd84: /* CSSELR */
          return cpu->env.v7m.csselr[attrs.secure];
 +    case 0xd88: /* CPACR */
 +        if (!arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
 +            return 0;
 +        }
 +        return cpu->env.v7m.cpacr[attrs.secure];
 +    case 0xd8c: /* NSACR */
 +        if (!attrs.secure || !arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
 +            return 0;
 +        }
 +        return cpu->env.v7m.nsacr;
      /* TODO: Implement debug registers.  */
      case 0xd90: /* MPU_TYPE */
          /* Unified MPU; if the MPU is not present this value is zero */
@@ -XXX,XX +XXX,XX @@ static uint32_t nvic_readl(NVICState *s, uint32_t offset, MemTxAttrs attrs)
              return 0;
          }
          return cpu->env.v7m.sfar;
 +    case 0xf34: /* FPCCR */
 +        if (!arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
 +            return 0;
 +        }
 +        if (attrs.secure) {
 +            return cpu->env.v7m.fpccr[M_REG_S];
 +        } else {
 +            /*
 +             * NS can read LSPEN, CLRONRET and MONRDY. It can read
 +             * BFRDY and HFRDY if AIRCR.BFHFNMINS != 0;
 +             * other non-banked bits RAZ.
 +             * TODO: MONRDY should RAZ/WI if DEMCR.SDME is set.
 +             */
 +            uint32_t value = cpu->env.v7m.fpccr[M_REG_S];
 +            uint32_t mask = R_V7M_FPCCR_LSPEN_MASK |
 +                R_V7M_FPCCR_CLRONRET_MASK |
 +                R_V7M_FPCCR_MONRDY_MASK;
 +
 +            if (s->cpu->env.v7m.aircr & R_V7M_AIRCR_BFHFNMINS_MASK) {
 +                mask |= R_V7M_FPCCR_BFRDY_MASK | R_V7M_FPCCR_HFRDY_MASK;
 +            }
 +
 +            value &= mask;
 +
 +            value |= cpu->env.v7m.fpccr[M_REG_NS];
 +            return value;
 +        }
 +    case 0xf38: /* FPCAR */
 +        if (!arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
 +            return 0;
 +        }
 +        return cpu->env.v7m.fpcar[attrs.secure];
 +    case 0xf3c: /* FPDSCR */
 +        if (!arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
 +            return 0;
 +        }
 +        return cpu->env.v7m.fpdscr[attrs.secure];
      case 0xf40: /* MVFR0 */
          return cpu->isar.mvfr0;
      case 0xf44: /* MVFR1 */
@@ -XXX,XX +XXX,XX @@ static void nvic_writel(NVICState *s, uint32_t offset, uint32_t value,
              cpu->env.v7m.csselr[attrs.secure] = value & R_V7M_CSSELR_INDEX_MASK;
          }
          break;
 +    case 0xd88: /* CPACR */
 +        if (arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
 +            /* We implement only the Floating Point extension's CP10/CP11 */
 +            cpu->env.v7m.cpacr[attrs.secure] = value & (0xf << 20);
 +        }
 +        break;
 +    case 0xd8c: /* NSACR */
 +        if (attrs.secure && arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
 +            /* We implement only the Floating Point extension's CP10/CP11 */
 +            cpu->env.v7m.nsacr = value & (3 << 10);
 +        }
 +        break;
      case 0xd90: /* MPU_TYPE */
          return; /* RO */
      case 0xd94: /* MPU_CTRL */
@@ -XXX,XX +XXX,XX @@ static void nvic_writel(NVICState *s, uint32_t offset, uint32_t value,
          }
          break;
      }
 +    case 0xf34: /* FPCCR */
 +        if (arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
 +            /* Not all bits here are banked. */
 +            uint32_t fpccr_s;
 +
 +            if (!arm_feature(&cpu->env, ARM_FEATURE_V8)) {
 +                /* Don't allow setting of bits not present in v7M */
 +                value &= (R_V7M_FPCCR_LSPACT_MASK |
 +                          R_V7M_FPCCR_USER_MASK |
 +                          R_V7M_FPCCR_THREAD_MASK |
 +                          R_V7M_FPCCR_HFRDY_MASK |
 +                          R_V7M_FPCCR_MMRDY_MASK |
 +                          R_V7M_FPCCR_BFRDY_MASK |
 +                          R_V7M_FPCCR_MONRDY_MASK |
 +                          R_V7M_FPCCR_LSPEN_MASK |
 +                          R_V7M_FPCCR_ASPEN_MASK);
 +            }
 +            value &= ~R_V7M_FPCCR_RES0_MASK;
 +
 +            if (!attrs.secure) {
 +                /* Some non-banked bits are configurably writable by NS */
 +                fpccr_s = cpu->env.v7m.fpccr[M_REG_S];
 +                if (!(fpccr_s & R_V7M_FPCCR_LSPENS_MASK)) {
 +                    uint32_t lspen = FIELD_EX32(value, V7M_FPCCR, LSPEN);
 +                    fpccr_s = FIELD_DP32(fpccr_s, V7M_FPCCR, LSPEN, lspen);
 +                }
 +                if (!(fpccr_s & R_V7M_FPCCR_CLRONRETS_MASK)) {
 +                    uint32_t cor = FIELD_EX32(value, V7M_FPCCR, CLRONRET);
 +                    fpccr_s = FIELD_DP32(fpccr_s, V7M_FPCCR, CLRONRET, cor);
 +                }
 +                if ((s->cpu->env.v7m.aircr & R_V7M_AIRCR_BFHFNMINS_MASK)) {
 +                    uint32_t hfrdy = FIELD_EX32(value, V7M_FPCCR, HFRDY);
 +                    uint32_t bfrdy = FIELD_EX32(value, V7M_FPCCR, BFRDY);
 +                    fpccr_s = FIELD_DP32(fpccr_s, V7M_FPCCR, HFRDY, hfrdy);
 +                    fpccr_s = FIELD_DP32(fpccr_s, V7M_FPCCR, BFRDY, bfrdy);
 +                }
 +                /* TODO MONRDY should RAZ/WI if DEMCR.SDME is set */
 +                {
 +                    uint32_t monrdy = FIELD_EX32(value, V7M_FPCCR, MONRDY);
 +                    fpccr_s = FIELD_DP32(fpccr_s, V7M_FPCCR, MONRDY, monrdy);
 +                }
 +
 +                /*
 +                 * All other non-banked bits are RAZ/WI from NS; write
 +                 * just the banked bits to fpccr[M_REG_NS].
 +                 */
 +                value &= R_V7M_FPCCR_BANKED_MASK;
 +                cpu->env.v7m.fpccr[M_REG_NS] = value;
 +            } else {
 +                fpccr_s = value;
 +            }
 +            cpu->env.v7m.fpccr[M_REG_S] = fpccr_s;
 +        }
 +        break;
 +    case 0xf38: /* FPCAR */
 +        if (arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
 +            value &= ~7;
 +            cpu->env.v7m.fpcar[attrs.secure] = value;
 +        }
 +        break;
 +    case 0xf3c: /* FPDSCR */
 +        if (arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
 +            value &= 0x07c00000;
 +            cpu->env.v7m.fpdscr[attrs.secure] = value;
 +        }
 +        break;
      case 0xf50: /* ICIALLU */
      case 0xf58: /* ICIMVAU */
      case 0xf5c: /* DCIMVAC */
 diff --git a/target/arm/cpu.c b/target/arm/cpu.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu.c
 +++ b/target/arm/cpu.c
 @@ -XXX,XX +XXX,XX @@ static void arm_cpu_reset(CPUState *s)
-         env->cp15.sctlr_el[1] |= SCTLR_UCT | SCTLR_UCI | SCTLR_DZE;
+             env->v7m.ccr[M_REG_S] |= R_V7M_CCR_UNALIGN_TRP_MASK;
-         /* and to the FP/Neon instructions */
+         }
-         env->cp15.cpacr_el1 = deposit64(env->cp15.cpacr_el1, 20, 2, 3);
-+        /* and to the SVE instructions */
++        if (arm_feature(env, ARM_FEATURE_VFP)) {
-+        env->cp15.cpacr_el1 = deposit64(env->cp15.cpacr_el1, 16, 2, 3);
++            env->v7m.fpccr[M_REG_NS] = R_V7M_FPCCR_ASPEN_MASK;
-+        env->cp15.cptr_el[3] |= CPTR_EZ;
++            env->v7m.fpccr[M_REG_S] = R_V7M_FPCCR_ASPEN_MASK |
-+        /* with maximum vector length */
++                R_V7M_FPCCR_LSPEN_MASK | R_V7M_FPCCR_S_MASK;
-+        env->vfp.zcr_el[1] = ARM_MAX_VQ - 1;
++        }
-+        env->vfp.zcr_el[2] = ARM_MAX_VQ - 1;
+         /* Unlike A/R profile, M profile defines the reset LR value */
-+        env->vfp.zcr_el[3] = ARM_MAX_VQ - 1;
+         env->regs[14] = 0xffffffff;
- #else
-         /* Reset into the highest available EL */
+diff --git a/target/arm/machine.c b/target/arm/machine.c
-         if (arm_feature(env, ARM_FEATURE_EL3)) {
+index XXXXXXX..XXXXXXX 100644
-diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
+--- a/target/arm/machine.c
-index XXXXXXX..XXXXXXX 100644
++++ b/target/arm/machine.c
---- a/target/arm/cpu64.c
+@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_m_v8m = {
-+++ b/target/arm/cpu64.c
+     }
-@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
+ };
-         set_feature(&cpu->env, ARM_FEATURE_V8_RDM);
-         set_feature(&cpu->env, ARM_FEATURE_V8_FP16);
++static const VMStateDescription vmstate_m_fp = {
-         set_feature(&cpu->env, ARM_FEATURE_V8_FCMA);
++    .name = "cpu/m/fp",
-+        set_feature(&cpu->env, ARM_FEATURE_SVE);
++    .version_id = 1,
-         /* For usermode -cpu max we can use a larger and more efficient DCZ
++    .minimum_version_id = 1,
-          * blocksize since we don't have to follow what the hardware does.
++    .needed = vfp_needed,
-          */
++    .fields = (VMStateField[]) {
 +        VMSTATE_UINT32_ARRAY(env.v7m.fpcar, ARMCPU, M_REG_NUM_BANKS),
 +        VMSTATE_UINT32_ARRAY(env.v7m.fpccr, ARMCPU, M_REG_NUM_BANKS),
 +        VMSTATE_UINT32_ARRAY(env.v7m.fpdscr, ARMCPU, M_REG_NUM_BANKS),
 +        VMSTATE_UINT32_ARRAY(env.v7m.cpacr, ARMCPU, M_REG_NUM_BANKS),
 +        VMSTATE_UINT32(env.v7m.nsacr, ARMCPU),
 +        VMSTATE_END_OF_LIST()
 +    }
 +};
 +
  static const VMStateDescription vmstate_m = {
      .name = "cpu/m",
      .version_id = 4,
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_m = {
          &vmstate_m_scr,
          &vmstate_m_other_sp,
          &vmstate_m_v8m,
 +        &vmstate_m_fp,
          NULL
      }
  };
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 50/55] sdcard: Use the ldst API
+[Qemu-devel] [PULL 07/42] target/arm: Disable most VFP sysregs for M-profile
-From: Philippe Mathieu-Daudé <f4bug@amsat.org>
+The only "system register" that M-profile floating point exposes
 via the VMRS/VMRS instructions is FPSCR, and it does not have
 the odd special case for rd==15. Add a check to ensure we only
 expose FPSCR.
-The load/store API will ease further code movement.
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20190416125744.27770-5-peter.maydell@linaro.org
 ---
  target/arm/translate.c | 19 +++++++++++++++++--
 file changed, 17 insertions(+), 2 deletions(-)
-Per the Physical Layer Simplified Spec. "3.6 Bus Protocol":
+diff --git a/target/arm/translate.c b/target/arm/translate.c
   "In the CMD line the Most Significant Bit (MSB) is transmitted
    first, the Least Significant Bit (LSB) is the last."
 Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  hw/sd/bcm2835_sdhost.c    | 13 +++++--------
  hw/sd/milkymist-memcard.c |  3 +--
  hw/sd/omap_mmc.c          |  6 ++----
  hw/sd/pl181.c             | 11 ++++-------
  hw/sd/sdhci.c             | 15 +++++----------
  hw/sd/ssi-sd.c            |  6 ++----
 files changed, 19 insertions(+), 35 deletions(-)
 diff --git a/hw/sd/bcm2835_sdhost.c b/hw/sd/bcm2835_sdhost.c
 index XXXXXXX..XXXXXXX 100644
---- a/hw/sd/bcm2835_sdhost.c
+--- a/target/arm/translate.c
-+++ b/hw/sd/bcm2835_sdhost.c
++++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static void bcm2835_sdhost_send_command(BCM2835SDHostState *s)
+@@ -XXX,XX +XXX,XX @@ static int disas_vfp_insn(DisasContext *s, uint32_t insn)
-         goto error;
+                     }
-     }
+                 }
-     if (!(s->cmd & SDCMD_NO_RESPONSE)) {
+             } else { /* !dp */
--#define RWORD(n) (((uint32_t)rsp[n] << 24) | (rsp[n + 1] << 16) \
++                bool is_sysreg;
--                  | (rsp[n + 2] << 8) | rsp[n + 3])
++
-         if (rlen == 0 || (rlen == 4 && (s->cmd & SDCMD_LONG_RESPONSE))) {
+                 if ((insn & 0x6f) != 0x00)
-             goto error;
+                     return 1;
-         }
+                 rn = VFP_SREG_N(insn);
-@@ -XXX,XX +XXX,XX @@ static void bcm2835_sdhost_send_command(BCM2835SDHostState *s)
++
-             goto error;
++                is_sysreg = extract32(insn, 21, 1);
-         }
++
-         if (rlen == 4) {
++                if (arm_dc_feature(s, ARM_FEATURE_M)) {
--            s->rsp[0] = RWORD(0);
++                    /*
-+            s->rsp[0] = ldl_be_p(&rsp[0]);
++                     * The only M-profile VFP vmrs/vmsr sysreg is FPSCR.
-             s->rsp[1] = s->rsp[2] = s->rsp[3] = 0;
++                     * Writes to R15 are UNPREDICTABLE; we choose to undef.
-         } else {
++                     */
--            s->rsp[0] = RWORD(12);
++                    if (is_sysreg && (rd == 15 || (rn >> 1) != ARM_VFP_FPSCR)) {
--            s->rsp[1] = RWORD(8);
++                        return 1;
--            s->rsp[2] = RWORD(4);
++                    }
--            s->rsp[3] = RWORD(0);
++                }
-+            s->rsp[0] = ldl_be_p(&rsp[12]);
++
-+            s->rsp[1] = ldl_be_p(&rsp[8]);
+                 if (insn & ARM_CP_RW_BIT) {
-+            s->rsp[2] = ldl_be_p(&rsp[4]);
+                     /* vfp->arm */
-+            s->rsp[3] = ldl_be_p(&rsp[0]);
+-                    if (insn & (1 << 21)) {
-         }
++                    if (is_sysreg) {
--#undef RWORD
+                         /* system register */
-     }
+                         rn >>= 1;
-     /* We never really delay commands, so if this was a 'busywait' command
-      * then we've completed it now and can raise the interrupt.
+@@ -XXX,XX +XXX,XX @@ static int disas_vfp_insn(DisasContext *s, uint32_t insn)
-diff --git a/hw/sd/milkymist-memcard.c b/hw/sd/milkymist-memcard.c
+                     }
-index XXXXXXX..XXXXXXX 100644
+                 } else {
---- a/hw/sd/milkymist-memcard.c
+                     /* arm->vfp */
-+++ b/hw/sd/milkymist-memcard.c
+-                    if (insn & (1 << 21)) {
-@@ -XXX,XX +XXX,XX @@ static void memcard_sd_command(MilkymistMemcardState *s)
++                    if (is_sysreg) {
-     SDRequest req;
+                         rn >>= 1;
+                         /* system register */
-     req.cmd = s->command[0] & 0x3f;
+                         switch (rn) {
 -    req.arg = (s->command[1] << 24) | (s->command[2] << 16)
 -              | (s->command[3] << 8) | s->command[4];
 +    req.arg = ldl_be_p(s->command + 1);
      req.crc = s->command[5];
      s->response[0] = req.cmd;
 diff --git a/hw/sd/omap_mmc.c b/hw/sd/omap_mmc.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/sd/omap_mmc.c
 +++ b/hw/sd/omap_mmc.c
@@ -XXX,XX +XXX,XX @@ static void omap_mmc_command(struct omap_mmc_s *host, int cmd, int dir,
                  CID_CSD_OVERWRITE;
          if (host->sdio & (1 << 13))
              mask |= AKE_SEQ_ERROR;
 -        rspstatus = (response[0] << 24) | (response[1] << 16) |
 -                (response[2] << 8) | (response[3] << 0);
 +        rspstatus = ldl_be_p(response);
          break;
      case sd_r2:
@@ -XXX,XX +XXX,XX @@ static void omap_mmc_command(struct omap_mmc_s *host, int cmd, int dir,
          }
          rsplen = 4;
 -        rspstatus = (response[0] << 24) | (response[1] << 16) |
 -                (response[2] << 8) | (response[3] << 0);
 +        rspstatus = ldl_be_p(response);
          if (rspstatus & 0x80000000)
              host->status &= 0xe000;
          else
 diff --git a/hw/sd/pl181.c b/hw/sd/pl181.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/sd/pl181.c
 +++ b/hw/sd/pl181.c
@@ -XXX,XX +XXX,XX @@ static void pl181_send_command(PL181State *s)
      if (rlen < 0)
          goto error;
      if (s->cmd & PL181_CMD_RESPONSE) {
 -#define RWORD(n) (((uint32_t)response[n] << 24) | (response[n + 1] << 16) \
 -                  | (response[n + 2] << 8) | response[n + 3])
          if (rlen == 0 || (rlen == 4 && (s->cmd & PL181_CMD_LONGRESP)))
              goto error;
          if (rlen != 4 && rlen != 16)
              goto error;
 -        s->response[0] = RWORD(0);
 +        s->response[0] = ldl_be_p(&response[0]);
          if (rlen == 4) {
              s->response[1] = s->response[2] = s->response[3] = 0;
          } else {
 -            s->response[1] = RWORD(4);
 -            s->response[2] = RWORD(8);
 -            s->response[3] = RWORD(12) & ~1;
 +            s->response[1] = ldl_be_p(&response[4]);
 +            s->response[2] = ldl_be_p(&response[8]);
 +            s->response[3] = ldl_be_p(&response[12]) & ~1;
          }
          DPRINTF("Response received\n");
          s->status |= PL181_STATUS_CMDRESPEND;
 -#undef RWORD
      } else {
          DPRINTF("Command sent\n");
          s->status |= PL181_STATUS_CMDSENT;
 diff --git a/hw/sd/sdhci.c b/hw/sd/sdhci.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/sd/sdhci.c
 +++ b/hw/sd/sdhci.c
@@ -XXX,XX +XXX,XX @@ static void sdhci_send_command(SDHCIState *s)
      if (s->cmdreg & SDHC_CMD_RESPONSE) {
          if (rlen == 4) {
 -            s->rspreg[0] = (response[0] << 24) | (response[1] << 16) |
 -                           (response[2] << 8)  |  response[3];
 +            s->rspreg[0] = ldl_be_p(response);
              s->rspreg[1] = s->rspreg[2] = s->rspreg[3] = 0;
              trace_sdhci_response4(s->rspreg[0]);
          } else if (rlen == 16) {
 -            s->rspreg[0] = (response[11] << 24) | (response[12] << 16) |
 -                           (response[13] << 8) |  response[14];
 -            s->rspreg[1] = (response[7] << 24) | (response[8] << 16) |
 -                           (response[9] << 8)  |  response[10];
 -            s->rspreg[2] = (response[3] << 24) | (response[4] << 16) |
 -                           (response[5] << 8)  |  response[6];
 +            s->rspreg[0] = ldl_be_p(&response[11]);
 +            s->rspreg[1] = ldl_be_p(&response[7]);
 +            s->rspreg[2] = ldl_be_p(&response[3]);
              s->rspreg[3] = (response[0] << 16) | (response[1] << 8) |
                              response[2];
              trace_sdhci_response16(s->rspreg[3], s->rspreg[2],
@@ -XXX,XX +XXX,XX @@ static void sdhci_end_transfer(SDHCIState *s)
          trace_sdhci_end_transfer(request.cmd, request.arg);
          sdbus_do_command(&s->sdbus, &request, response);
          /* Auto CMD12 response goes to the upper Response register */
 -        s->rspreg[3] = (response[0] << 24) | (response[1] << 16) |
 -                (response[2] << 8) | response[3];
 +        s->rspreg[3] = ldl_be_p(response);
      }
      s->prnsts &= ~(SDHC_DOING_READ | SDHC_DOING_WRITE |
 diff --git a/hw/sd/ssi-sd.c b/hw/sd/ssi-sd.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/sd/ssi-sd.c
 +++ b/hw/sd/ssi-sd.c
@@ -XXX,XX +XXX,XX @@ static uint32_t ssi_sd_transfer(SSISlave *dev, uint32_t val)
              uint8_t longresp[16];
              /* FIXME: Check CRC.  */
              request.cmd = s->cmd;
 -            request.arg = (s->cmdarg[0] << 24) | (s->cmdarg[1] << 16)
 -                           | (s->cmdarg[2] << 8) | s->cmdarg[3];
 +            request.arg = ldl_be_p(s->cmdarg);
              DPRINTF("CMD%d arg 0x%08x\n", s->cmd, request.arg);
              s->arglen = sdbus_do_command(&s->sdbus, &request, longresp);
              if (s->arglen <= 0) {
@@ -XXX,XX +XXX,XX @@ static uint32_t ssi_sd_transfer(SSISlave *dev, uint32_t val)
                  /* CMD13 returns a 2-byte statuse work. Other commands
                     only return the first byte.  */
                  s->arglen = (s->cmd == 13) ? 2 : 1;
 -                cardstatus = (longresp[0] << 24) | (longresp[1] << 16)
 -                             | (longresp[2] << 8) | longresp[3];
 +                cardstatus = ldl_be_p(longresp);
                  status = 0;
                  if (((cardstatus >> 9) & 0xf) < 4)
                      status |= SSI_SDR_IDLE;
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 15/55] target/arm: Implement SVE load and broadcast element
+[Qemu-devel] [PULL 08/42] target/arm: Honour M-profile FP enable bits
-From: Richard Henderson <richard.henderson@linaro.org>
+Like AArch64, M-profile floating point has no FPEXC enable
 bit to gate floating point; so always set the VFPEN TB flag.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+M-profile also has CPACR and NSACR similar to A-profile;
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+they behave slightly differently:
-Message-id: 20180627043328.11531-10-richard.henderson@linaro.org
+ * the CPACR is banked between Secure and Non-Secure
  * if the NSACR forces a trap then this is taken to
    the Secure state, not the Non-Secure state
 Honour the CPACR and NSACR settings. The NSACR handling
 requires us to borrow the exception.target_el field
 (usually meaningless for M profile) to distinguish the
 NOCP UsageFault taken to Secure state from the more
 usual fault taken to the current security state.
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-6-peter.maydell@linaro.org
 ---
- target/arm/helper-sve.h    |  5 +++
+ target/arm/helper.c    | 55 +++++++++++++++++++++++++++++++++++++++---
- target/arm/sve_helper.c    | 41 +++++++++++++++++++++++++
+ target/arm/translate.c | 10 ++++++--
- target/arm/translate-sve.c | 62 ++++++++++++++++++++++++++++++++++++++
+files changed, 60 insertions(+), 5 deletions(-)
  target/arm/sve.decode      |  5 +++
 files changed, 113 insertions(+)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
+diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
+--- a/target/arm/helper.c
-+++ b/target/arm/helper-sve.h
++++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_3(sve_clr_h, TCG_CALL_NO_RWG, void, ptr, ptr, i32)
+@@ -XXX,XX +XXX,XX @@ uint32_t arm_phys_excp_target_el(CPUState *cs, uint32_t excp_idx,
- DEF_HELPER_FLAGS_3(sve_clr_s, TCG_CALL_NO_RWG, void, ptr, ptr, i32)
+     return target_el;
  DEF_HELPER_FLAGS_3(sve_clr_d, TCG_CALL_NO_RWG, void, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_4(sve_movz_b, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_4(sve_movz_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_4(sve_movz_s, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_4(sve_movz_d, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
 +
  DEF_HELPER_FLAGS_4(sve_asr_zpzi_b, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
  DEF_HELPER_FLAGS_4(sve_asr_zpzi_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
  DEF_HELPER_FLAGS_4(sve_asr_zpzi_s, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
 diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve_helper.c
 +++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(sve_clr_d)(void *vd, void *vg, uint32_t desc)
      }
  }
-+/* Copy Zn into Zd, and store zero into inactive elements.  */
++/*
-+void HELPER(sve_movz_b)(void *vd, void *vn, void *vg, uint32_t desc)
++ * Return true if the v7M CPACR permits access to the FPU for the specified
 + * security state and privilege level.
 + */
 +static bool v7m_cpacr_pass(CPUARMState *env, bool is_secure, bool is_priv)
 +{
-+    intptr_t i, opr_sz = simd_oprsz(desc) / 8;
++    switch (extract32(env->v7m.cpacr[is_secure], 20, 2)) {
-+    uint64_t *d = vd, *n = vn;
++    case 0:
-+    uint8_t *pg = vg;
++    case 2: /* UNPREDICTABLE: we treat like 0 */
-+    for (i = 0; i < opr_sz; i += 1) {
++        return false;
-+        d[i] = n[i] & expand_pred_b(pg[H1(i)]);
++    case 1:
 +        return is_priv;
 +    case 3:
 +        return true;
 +    default:
 +        g_assert_not_reached();
 +    }
 +}
 +
-+void HELPER(sve_movz_h)(void *vd, void *vn, void *vg, uint32_t desc)
+ static bool v7m_stack_write(ARMCPU *cpu, uint32_t addr, uint32_t value,
-+{
+                             ARMMMUIdx mmu_idx, bool ignfault)
-+    intptr_t i, opr_sz = simd_oprsz(desc) / 8;
+ {
-+    uint64_t *d = vd, *n = vn;
+@@ -XXX,XX +XXX,XX @@ void arm_v7m_cpu_do_interrupt(CPUState *cs)
-+    uint8_t *pg = vg;
+         env->v7m.cfsr[env->v7m.secure] |= R_V7M_CFSR_UNDEFINSTR_MASK;
-+    for (i = 0; i < opr_sz; i += 1) {
+         break;
-+        d[i] = n[i] & expand_pred_h(pg[H1(i)]);
+     case EXCP_NOCP:
 -        armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE, env->v7m.secure);
 -        env->v7m.cfsr[env->v7m.secure] |= R_V7M_CFSR_NOCP_MASK;
 +    {
 +        /*
 +         * NOCP might be directed to something other than the current
 +         * security state if this fault is because of NSACR; we indicate
 +         * the target security state using exception.target_el.
 +         */
 +        int target_secstate;
 +
 +        if (env->exception.target_el == 3) {
 +            target_secstate = M_REG_S;
 +        } else {
 +            target_secstate = env->v7m.secure;
 +        }
 +        armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE, target_secstate);
 +        env->v7m.cfsr[target_secstate] |= R_V7M_CFSR_NOCP_MASK;
          break;
 +    }
-+}
+     case EXCP_INVSTATE:
          armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE, env->v7m.secure);
          env->v7m.cfsr[env->v7m.secure] |= R_V7M_CFSR_INVSTATE_MASK;
@@ -XXX,XX +XXX,XX @@ int fp_exception_el(CPUARMState *env, int cur_el)
          return 0;
      }
 +    if (arm_feature(env, ARM_FEATURE_M)) {
 +        /* CPACR can cause a NOCP UsageFault taken to current security state */
 +        if (!v7m_cpacr_pass(env, env->v7m.secure, cur_el != 0)) {
 +            return 1;
 +        }
 +
-+void HELPER(sve_movz_s)(void *vd, void *vn, void *vg, uint32_t desc)
++        if (arm_feature(env, ARM_FEATURE_M_SECURITY) && !env->v7m.secure) {
-+{
++            if (!extract32(env->v7m.nsacr, 10, 1)) {
-+    intptr_t i, opr_sz = simd_oprsz(desc) / 8;
++                /* FP insns cause a NOCP UsageFault taken to Secure */
-+    uint64_t *d = vd, *n = vn;
++                return 3;
-+    uint8_t *pg = vg;
++            }
-+    for (i = 0; i < opr_sz; i += 1) {
++        }
 +        d[i] = n[i] & expand_pred_s(pg[H1(i)]);
 +    }
 +}
 +
-+void HELPER(sve_movz_d)(void *vd, void *vn, void *vg, uint32_t desc)
++        return 0;
 +{
 +    intptr_t i, opr_sz = simd_oprsz(desc) / 8;
 +    uint64_t *d = vd, *n = vn;
 +    uint8_t *pg = vg;
 +    for (i = 0; i < opr_sz; i += 1) {
 +        d[i] = n[1] & -(uint64_t)(pg[H1(i)] & 1);
 +    }
 +}
 +
  /* Three-operand expander, immediate operand, controlled by a predicate.
   */
  #define DO_ZPZI(NAME, TYPE, H, OP)                              \
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-sve.c
 +++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_clr_zp(DisasContext *s, int rd, int pg, int esz)
      return true;
  }
 +/* Copy Zn into Zd, storing zeros into inactive elements.  */
 +static void do_movz_zpz(DisasContext *s, int rd, int rn, int pg, int esz)
 +{
 +    static gen_helper_gvec_3 * const fns[4] = {
 +        gen_helper_sve_movz_b, gen_helper_sve_movz_h,
 +        gen_helper_sve_movz_s, gen_helper_sve_movz_d,
 +    };
 +    unsigned vsz = vec_full_reg_size(s);
 +    tcg_gen_gvec_3_ool(vec_full_reg_offset(s, rd),
 +                       vec_full_reg_offset(s, rn),
 +                       pred_full_reg_offset(s, pg),
 +                       vsz, vsz, 0, fns[esz]);
 +}
 +
  static bool do_zpzi_ool(DisasContext *s, arg_rpri_esz *a,
                          gen_helper_gvec_3 *fn)
  {
@@ -XXX,XX +XXX,XX @@ static bool trans_LD1RQ_zpri(DisasContext *s, arg_rpri_load *a, uint32_t insn)
      return true;
  }
 +/* Load and broadcast element.  */
 +static bool trans_LD1R_zpri(DisasContext *s, arg_rpri_load *a, uint32_t insn)
 +{
 +    if (!sve_access_check(s)) {
 +        return true;
 +    }
 +
-+    unsigned vsz = vec_full_reg_size(s);
+     /* The CPACR controls traps to EL1, or PL1 if we're 32 bit:
-+    unsigned psz = pred_full_reg_size(s);
+      * 0, 2 : trap EL0 and EL1/PL1 accesses
-+    unsigned esz = dtype_esz[a->dtype];
+      * 1    : trap only EL0 accesses
-+    TCGLabel *over = gen_new_label();
+@@ -XXX,XX +XXX,XX @@ void cpu_get_tb_cpu_state(CPUARMState *env, target_ulong *pc,
-+    TCGv_i64 temp;
+         flags = FIELD_DP32(flags, TBFLAG_A32, SCTLR_B, arm_sctlr_b(env));
-+
+         flags = FIELD_DP32(flags, TBFLAG_A32, NS, !access_secure_reg(env));
-+    /* If the guarding predicate has no bits set, no load occurs.  */
+         if (env->vfp.xregs[ARM_VFP_FPEXC] & (1 << 30)
-+    if (psz <= 8) {
+-            || arm_el_is_aa64(env, 1)) {
-+        /* Reduce the pred_esz_masks value simply to reduce the
++            || arm_el_is_aa64(env, 1) || arm_feature(env, ARM_FEATURE_M)) {
-+         * size of the code generated here.
+             flags = FIELD_DP32(flags, TBFLAG_A32, VFPEN, 1);
-+         */
+         }
-+        uint64_t psz_mask = MAKE_64BIT_MASK(0, psz * 8);
+         flags = FIELD_DP32(flags, TBFLAG_A32, XSCALE_CPAR, env->cp15.c15_cpar);
-+        temp = tcg_temp_new_i64();
+diff --git a/target/arm/translate.c b/target/arm/translate.c
 +        tcg_gen_ld_i64(temp, cpu_env, pred_full_reg_offset(s, a->pg));
 +        tcg_gen_andi_i64(temp, temp, pred_esz_masks[esz] & psz_mask);
 +        tcg_gen_brcondi_i64(TCG_COND_EQ, temp, 0, over);
 +        tcg_temp_free_i64(temp);
 +    } else {
 +        TCGv_i32 t32 = tcg_temp_new_i32();
 +        find_last_active(s, t32, esz, a->pg);
 +        tcg_gen_brcondi_i32(TCG_COND_LT, t32, 0, over);
 +        tcg_temp_free_i32(t32);
 +    }
 +
 +    /* Load the data.  */
 +    temp = tcg_temp_new_i64();
 +    tcg_gen_addi_i64(temp, cpu_reg_sp(s, a->rn), a->imm << esz);
 +    tcg_gen_qemu_ld_i64(temp, temp, get_mem_index(s),
 +                        s->be_data | dtype_mop[a->dtype]);
 +
 +    /* Broadcast to *all* elements.  */
 +    tcg_gen_gvec_dup_i64(esz, vec_full_reg_offset(s, a->rd),
 +                         vsz, vsz, temp);
 +    tcg_temp_free_i64(temp);
 +
 +    /* Zero the inactive elements.  */
 +    gen_set_label(over);
 +    do_movz_zpz(s, a->rd, a->rd, a->pg, esz);
 +    return true;
 +}
 +
  static void do_st_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
                        int msz, int esz, int nreg)
  {
 diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
+--- a/target/arm/translate.c
-+++ b/target/arm/sve.decode
++++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@
+@@ -XXX,XX +XXX,XX @@ static int disas_vfp_insn(DisasContext *s, uint32_t insn)
- %imm8_16_10     16:5 10:3
+      * for attempts to execute invalid vfp/neon encodings with FP disabled.
- %imm9_16_10     16:s6 10:3
+      */
- %size_23        23:2
+     if (s->fp_excp_el) {
-+%dtype_23_13    23:2 13:2
+-        gen_exception_insn(s, 4, EXCP_UDEF,
+-                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
- # A combination of tsz:imm3 -- extract esize.
++        if (arm_dc_feature(s, ARM_FEATURE_M)) {
- %tszimm_esz     22:2 5:5 !function=tszimm_esz
++            gen_exception_insn(s, 4, EXCP_NOCP, syn_uncategorized(),
-@@ -XXX,XX +XXX,XX @@ LDR_pri         10000101 10 ...... 000 ... ..... 0 ....         @pd_rn_i9
++                               s->fp_excp_el);
- # SVE load vector register
++        } else {
- LDR_zri         10000101 10 ...... 010 ... ..... .....          @rd_rn_i9
++            gen_exception_insn(s, 4, EXCP_UDEF,
++                               syn_fp_access_trap(1, 0xe, false),
-+# SVE load and broadcast element
++                               s->fp_excp_el);
-+LD1R_zpri       1000010 .. 1 imm:6 1.. pg:3 rn:5 rd:5 \
++        }
-+                &rpri_load dtype=%dtype_23_13 nreg=0
+         return 0;
-+
+     }
- ### SVE Memory Contiguous Load Group
  # SVE contiguous load (scalar plus scalar)
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 47/55] target/arm: Remove redundant DIV detection for KVM
+[Qemu-devel] [PULL 09/42] target/arm: Decode FP instructions for M profile
-From: Aaron Lindsay <alindsay@codeaurora.org>
+Correct the decode of the M-profile "coprocessor and
 floating-point instructions" space:
  * op0 == 0b11 is always unallocated
  * if the CPU has an FPU then all insns with op1 == 0b101
    are floating point and go to disas_vfp_insn()
-KVM implies V7VE, which implies ARM_DIV and THUMB_DIV. The conditional
+For the moment we leave VLLDM and VLSTM as NOPs; in
-detection here is therefore unnecessary. Because V7VE is already
+a later commit we will fill in the proper implementation
-unconditionally specified for all KVM hosts, ARM_DIV and THUMB_DIV are
+for the case where an FPU is present.
 already indirectly specified and do not need to be included here at all.
-Signed-off-by: Aaron Lindsay <alindsay@codeaurora.org>
-Message-id: 1529699547-17044-6-git-send-email-alindsay@codeaurora.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-7-peter.maydell@linaro.org
 ---
- target/arm/kvm32.c | 19 +------------------
+ target/arm/translate.c | 26 ++++++++++++++++++++++----
-file changed, 1 insertion(+), 18 deletions(-)
+file changed, 22 insertions(+), 4 deletions(-)
-diff --git a/target/arm/kvm32.c b/target/arm/kvm32.c
+diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/kvm32.c
+--- a/target/arm/translate.c
-+++ b/target/arm/kvm32.c
++++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ bool kvm_arm_get_host_cpu_features(ARMHostCPUFeatures *ahcf)
+@@ -XXX,XX +XXX,XX @@ static void disas_thumb2_insn(DisasContext *s, uint32_t insn)
-      * and then query that CPU for the relevant ID registers.
+     case 6: case 7: case 14: case 15:
-      */
+         /* Coprocessor.  */
-     int i, ret, fdarray[3];
+         if (arm_dc_feature(s, ARM_FEATURE_M)) {
--    uint32_t midr, id_pfr0, id_isar0, mvfr1;
+-            /* We don't currently implement M profile FP support,
-+    uint32_t midr, id_pfr0, mvfr1;
+-             * so this entire space should give a NOCP fault, with
-     uint64_t features = 0;
+-             * the exception of the v8M VLLDM and VLSTM insns, which
-     /* Old kernels may not know about the PREFERRED_TARGET ioctl: however
+-             * must be NOPs in Secure state and UNDEF in Nonsecure state.
-      * we know these will only support creating one kind of guest CPU,
++            /* 0b111x_11xx_xxxx_xxxx_xxxx_xxxx_xxxx_xxxx */
-@@ -XXX,XX +XXX,XX @@ bool kvm_arm_get_host_cpu_features(ARMHostCPUFeatures *ahcf)
++            if (extract32(insn, 24, 2) == 3) {
-             | ENCODE_CP_REG(15, 0, 0, 0, 1, 0, 0),
++                goto illegal_op; /* op0 = 0b11 : unallocated */
-             .addr = (uintptr_t)&id_pfr0,
++            }
-         },
++
--        {
++            /*
--            .id = KVM_REG_ARM | KVM_REG_SIZE_U32
++             * Decode VLLDM and VLSTM first: these are nonstandard because:
--            | ENCODE_CP_REG(15, 0, 0, 0, 2, 0, 0),
++             *  * if there is no FPU then these insns must NOP in
--            .addr = (uintptr_t)&id_isar0,
++             *    Secure state and UNDEF in Nonsecure state
--        },
++             *  * if there is an FPU then these insns do not have
-         {
++             *    the usual behaviour that disas_vfp_insn() provides of
-             .id = KVM_REG_ARM | KVM_REG_SIZE_U32
++             *    being controlled by CPACR/NSACR enable bits or the
-             | KVM_REG_ARM_VFP | KVM_REG_ARM_VFP_MVFR1,
++             *    lazy-stacking logic.
-@@ -XXX,XX +XXX,XX @@ bool kvm_arm_get_host_cpu_features(ARMHostCPUFeatures *ahcf)
+              */
-     set_feature(&features, ARM_FEATURE_VFP3);
+             if (arm_dc_feature(s, ARM_FEATURE_V8) &&
-     set_feature(&features, ARM_FEATURE_GENERIC_TIMER);
+                 (insn & 0xffa00f00) == 0xec200a00) {
+@@ -XXX,XX +XXX,XX @@ static void disas_thumb2_insn(DisasContext *s, uint32_t insn)
--    switch (extract32(id_isar0, 24, 4)) {
+                 /* Just NOP since FP support is not implemented */
--    case 1:
+                 break;
--        set_feature(&features, ARM_FEATURE_THUMB_DIV);
+             }
--        break;
++            if (arm_dc_feature(s, ARM_FEATURE_VFP) &&
--    case 2:
++                ((insn >> 8) & 0xe) == 10) {
--        set_feature(&features, ARM_FEATURE_ARM_DIV);
++                /* FP, and the CPU supports it */
--        set_feature(&features, ARM_FEATURE_THUMB_DIV);
++                if (disas_vfp_insn(s, insn)) {
--        break;
++                    goto illegal_op;
--    default:
++                }
--        break;
++                break;
--    }
++            }
--
++
-     if (extract32(id_pfr0, 12, 4) == 1) {
+             /* All other insns: NOCP */
-         set_feature(&features, ARM_FEATURE_THUMB2EE);
+             gen_exception_insn(s, 4, EXCP_NOCP, syn_uncategorized(),
-     }
+                                default_exception_el(s));
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 52/55] target/arm: Fix SVE system register access checks
+[Qemu-devel] [PULL 10/42] target/arm: Clear CONTROL_S.SFPA in SG insn if FPU present
-From: Richard Henderson <richard.henderson@linaro.org>
+If the floating point extension is present, then the SG instruction
 must clear the CONTROL_S.SFPA bit. Implement this.
-Leave ARM_CP_SVE, removing ARM_CP_FPU; the sve_access_check
+(On a no-FPU system the bit will always be zero, so we don't need
-produced by the flag already includes fp_access_check.  If
+to make the clearing of the bit conditional on ARM_FEATURE_VFP.)
 we also check ARM_CP_FPU the double fp_access_check asserts.
-Reported-by: Laurent Desnogues <laurent.desnogues@gmail.com>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Reviewed-by: Laurent Desnogues <laurent.desnogues@gmail.com>
-Message-id: 20180629001538.11415-3-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-8-peter.maydell@linaro.org
 ---
- target/arm/helper.c        | 8 ++++----
+ target/arm/helper.c | 1 +
- target/arm/translate-a64.c | 5 ++---
+file changed, 1 insertion(+)
 files changed, 6 insertions(+), 7 deletions(-)
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ static void zcr_write(CPUARMState *env, const ARMCPRegInfo *ri,
+@@ -XXX,XX +XXX,XX @@ static bool v7m_handle_execute_nsc(ARMCPU *cpu)
- static const ARMCPRegInfo zcr_el1_reginfo = {
+     qemu_log_mask(CPU_LOG_INT, "...really an SG instruction at 0x%08" PRIx32
-     .name = "ZCR_EL1", .state = ARM_CP_STATE_AA64,
+                   ", executing it\n", env->regs[15]);
-     .opc0 = 3, .opc1 = 0, .crn = 1, .crm = 2, .opc2 = 0,
+     env->regs[14] &= ~1;
--    .access = PL1_RW, .type = ARM_CP_SVE | ARM_CP_FPU,
++    env->v7m.control[M_REG_S] &= ~R_V7M_CONTROL_SFPA_MASK;
-+    .access = PL1_RW, .type = ARM_CP_SVE,
+     switch_v7m_security_state(env, true);
-     .fieldoffset = offsetof(CPUARMState, vfp.zcr_el[1]),
+     xpsr_write(env, 0, XPSR_IT);
-     .writefn = zcr_write, .raw_writefn = raw_write
+     env->regs[15] += 4;
  };
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo zcr_el1_reginfo = {
  static const ARMCPRegInfo zcr_el2_reginfo = {
      .name = "ZCR_EL2", .state = ARM_CP_STATE_AA64,
      .opc0 = 3, .opc1 = 4, .crn = 1, .crm = 2, .opc2 = 0,
 -    .access = PL2_RW, .type = ARM_CP_SVE | ARM_CP_FPU,
 +    .access = PL2_RW, .type = ARM_CP_SVE,
      .fieldoffset = offsetof(CPUARMState, vfp.zcr_el[2]),
      .writefn = zcr_write, .raw_writefn = raw_write
  };
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo zcr_el2_reginfo = {
  static const ARMCPRegInfo zcr_no_el2_reginfo = {
      .name = "ZCR_EL2", .state = ARM_CP_STATE_AA64,
      .opc0 = 3, .opc1 = 4, .crn = 1, .crm = 2, .opc2 = 0,
 -    .access = PL2_RW, .type = ARM_CP_SVE | ARM_CP_FPU,
 +    .access = PL2_RW, .type = ARM_CP_SVE,
      .readfn = arm_cp_read_zero, .writefn = arm_cp_write_ignore
  };
  static const ARMCPRegInfo zcr_el3_reginfo = {
      .name = "ZCR_EL3", .state = ARM_CP_STATE_AA64,
      .opc0 = 3, .opc1 = 6, .crn = 1, .crm = 2, .opc2 = 0,
 -    .access = PL3_RW, .type = ARM_CP_SVE | ARM_CP_FPU,
 +    .access = PL3_RW, .type = ARM_CP_SVE,
      .fieldoffset = offsetof(CPUARMState, vfp.zcr_el[3]),
      .writefn = zcr_write, .raw_writefn = raw_write
  };
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void handle_sys(DisasContext *s, uint32_t insn, bool isread,
      default:
          break;
      }
 -    if ((ri->type & ARM_CP_SVE) && !sve_access_check(s)) {
 -        return;
 -    }
      if ((ri->type & ARM_CP_FPU) && !fp_access_check(s)) {
          return;
 +    } else if ((ri->type & ARM_CP_SVE) && !sve_access_check(s)) {
 +        return;
      }
      if ((tb_cflags(s->base.tb) & CF_USE_ICOUNT) && (ri->type & ARM_CP_IO)) {
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 21/55] target/arm: Implement SVE scatter store vector immediate
+[Qemu-devel] [PULL 11/42] target/arm: Handle SFPA and FPCA bits in reads and writes of CONTROL
-From: Richard Henderson <richard.henderson@linaro.org>
+The M-profile CONTROL register has two bits -- SFPA and FPCA --
 which relate to floating-point support, and should be RES0 otherwise.
 Handle them correctly in the MSR/MRS register access code.
 Neither is banked between security states, so they are stored
 in v7m.control[M_REG_S] regardless of current security state.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20180627043328.11531-16-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-9-peter.maydell@linaro.org
 ---
- target/arm/translate-sve.c | 85 ++++++++++++++++++++++++++------------
+ target/arm/helper.c | 57 ++++++++++++++++++++++++++++++++++++++-------
- target/arm/sve.decode      | 11 +++++
+file changed, 49 insertions(+), 8 deletions(-)
 files changed, 70 insertions(+), 26 deletions(-)
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
+--- a/target/arm/helper.c
-+++ b/target/arm/translate-sve.c
++++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ static bool trans_LD1_zpiz(DisasContext *s, arg_LD1_zpiz *a, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ uint32_t HELPER(v7m_mrs)(CPUARMState *env, uint32_t reg)
-     return true;
+         return xpsr_read(env) & mask;
- }
+         break;
+     case 20: /* CONTROL */
-+/* Indexed by [xs][msz].  */
+-        return env->v7m.control[env->v7m.secure];
-+static gen_helper_gvec_mem_scatter * const scatter_store_fn32[2][3] = {
++    {
-+    { gen_helper_sve_stbs_zsu,
++        uint32_t value = env->v7m.control[env->v7m.secure];
-+      gen_helper_sve_sths_zsu,
++        if (!env->v7m.secure) {
-+      gen_helper_sve_stss_zsu, },
++            /* SFPA is RAZ/WI from NS; FPCA is stored in the M_REG_S bank */
-+    { gen_helper_sve_stbs_zss,
++            value |= env->v7m.control[M_REG_S] & R_V7M_CONTROL_FPCA_MASK;
-+      gen_helper_sve_sths_zss,
++        }
-+      gen_helper_sve_stss_zss, },
++        return value;
-+};
++    }
-+
+     case 0x94: /* CONTROL_NS */
-+/* Note that we overload xs=2 to indicate 64-bit offset.  */
+         /* We have to handle this here because unprivileged Secure code
-+static gen_helper_gvec_mem_scatter * const scatter_store_fn64[3][4] = {
+          * can read the NS CONTROL register.
-+    { gen_helper_sve_stbd_zsu,
+@@ -XXX,XX +XXX,XX @@ uint32_t HELPER(v7m_mrs)(CPUARMState *env, uint32_t reg)
-+      gen_helper_sve_sthd_zsu,
+         if (!env->v7m.secure) {
-+      gen_helper_sve_stsd_zsu,
+             return 0;
-+      gen_helper_sve_stdd_zsu, },
+         }
-+    { gen_helper_sve_stbd_zss,
+-        return env->v7m.control[M_REG_NS];
-+      gen_helper_sve_sthd_zss,
++        return env->v7m.control[M_REG_NS] |
-+      gen_helper_sve_stsd_zss,
++            (env->v7m.control[M_REG_S] & R_V7M_CONTROL_FPCA_MASK);
 +      gen_helper_sve_stdd_zss, },
 +    { gen_helper_sve_stbd_zd,
 +      gen_helper_sve_sthd_zd,
 +      gen_helper_sve_stsd_zd,
 +      gen_helper_sve_stdd_zd, },
 +};
 +
  static bool trans_ST1_zprz(DisasContext *s, arg_ST1_zprz *a, uint32_t insn)
  {
 -    /* Indexed by [xs][msz].  */
 -    static gen_helper_gvec_mem_scatter * const fn32[2][3] = {
 -        { gen_helper_sve_stbs_zsu,
 -          gen_helper_sve_sths_zsu,
 -          gen_helper_sve_stss_zsu, },
 -        { gen_helper_sve_stbs_zss,
 -          gen_helper_sve_sths_zss,
 -          gen_helper_sve_stss_zss, },
 -    };
 -    /* Note that we overload xs=2 to indicate 64-bit offset.  */
 -    static gen_helper_gvec_mem_scatter * const fn64[3][4] = {
 -        { gen_helper_sve_stbd_zsu,
 -          gen_helper_sve_sthd_zsu,
 -          gen_helper_sve_stsd_zsu,
 -          gen_helper_sve_stdd_zsu, },
 -        { gen_helper_sve_stbd_zss,
 -          gen_helper_sve_sthd_zss,
 -          gen_helper_sve_stsd_zss,
 -          gen_helper_sve_stdd_zss, },
 -        { gen_helper_sve_stbd_zd,
 -          gen_helper_sve_sthd_zd,
 -          gen_helper_sve_stsd_zd,
 -          gen_helper_sve_stdd_zd, },
 -    };
      gen_helper_gvec_mem_scatter *fn;
      if (a->esz < a->msz || (a->msz == 0 && a->scale)) {
@@ -XXX,XX +XXX,XX @@ static bool trans_ST1_zprz(DisasContext *s, arg_ST1_zprz *a, uint32_t insn)
      }
-     switch (a->esz) {
-     case MO_32:
+     if (el == 0) {
--        fn = fn32[a->xs][a->msz];
+@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_msr)(CPUARMState *env, uint32_t maskreg, uint32_t val)
-+        fn = scatter_store_fn32[a->xs][a->msz];
+      */
      uint32_t mask = extract32(maskreg, 8, 4);
      uint32_t reg = extract32(maskreg, 0, 8);
 +    int cur_el = arm_current_el(env);
 -    if (arm_current_el(env) == 0 && reg > 7) {
 -        /* only xPSR sub-fields may be written by unprivileged */
 +    if (cur_el == 0 && reg > 7 && reg != 20) {
 +        /*
 +         * only xPSR sub-fields and CONTROL.SFPA may be written by
 +         * unprivileged code
 +         */
          return;
      }
@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_msr)(CPUARMState *env, uint32_t maskreg, uint32_t val)
                  env->v7m.control[M_REG_NS] &= ~R_V7M_CONTROL_NPRIV_MASK;
                  env->v7m.control[M_REG_NS] |= val & R_V7M_CONTROL_NPRIV_MASK;
              }
 +            /*
 +             * SFPA is RAZ/WI from NS. FPCA is RO if NSACR.CP10 == 0,
 +             * RES0 if the FPU is not present, and is stored in the S bank
 +             */
 +            if (arm_feature(env, ARM_FEATURE_VFP) &&
 +                extract32(env->v7m.nsacr, 10, 1)) {
 +                env->v7m.control[M_REG_S] &= ~R_V7M_CONTROL_FPCA_MASK;
 +                env->v7m.control[M_REG_S] |= val & R_V7M_CONTROL_FPCA_MASK;
 +            }
              return;
          case 0x98: /* SP_NS */
          {
@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_msr)(CPUARMState *env, uint32_t maskreg, uint32_t val)
          env->v7m.faultmask[env->v7m.secure] = val & 1;
          break;
-     case MO_64:
+     case 20: /* CONTROL */
--        fn = fn64[a->xs][a->msz];
+-        /* Writing to the SPSEL bit only has an effect if we are in
-+        fn = scatter_store_fn64[a->xs][a->msz];
++        /*
 +         * Writing to the SPSEL bit only has an effect if we are in
           * thread mode; other bits can be updated by any privileged code.
           * write_v7m_control_spsel() deals with updating the SPSEL bit in
           * env->v7m.control, so we only need update the others.
           * For v7M, we must just ignore explicit writes to SPSEL in handler
           * mode; for v8M the write is permitted but will have no effect.
 +         * All these bits are writes-ignored from non-privileged code,
 +         * except for SFPA.
           */
 -        if (arm_feature(env, ARM_FEATURE_V8) ||
 -            !arm_v7m_is_handler_mode(env)) {
 +        if (cur_el > 0 && (arm_feature(env, ARM_FEATURE_V8) ||
 +                           !arm_v7m_is_handler_mode(env))) {
              write_v7m_control_spsel(env, (val & R_V7M_CONTROL_SPSEL_MASK) != 0);
          }
 -        if (arm_feature(env, ARM_FEATURE_M_MAIN)) {
 +        if (cur_el > 0 && arm_feature(env, ARM_FEATURE_M_MAIN)) {
              env->v7m.control[env->v7m.secure] &= ~R_V7M_CONTROL_NPRIV_MASK;
              env->v7m.control[env->v7m.secure] |= val & R_V7M_CONTROL_NPRIV_MASK;
          }
 +        if (arm_feature(env, ARM_FEATURE_VFP)) {
 +            /*
 +             * SFPA is RAZ/WI from NS or if no FPU.
 +             * FPCA is RO if NSACR.CP10 == 0, RES0 if the FPU is not present.
 +             * Both are stored in the S bank.
 +             */
 +            if (env->v7m.secure) {
 +                env->v7m.control[M_REG_S] &= ~R_V7M_CONTROL_SFPA_MASK;
 +                env->v7m.control[M_REG_S] |= val & R_V7M_CONTROL_SFPA_MASK;
 +            }
 +            if (cur_el > 0 &&
 +                (env->v7m.secure || !arm_feature(env, ARM_FEATURE_M_SECURITY) ||
 +                 extract32(env->v7m.nsacr, 10, 1))) {
 +                env->v7m.control[M_REG_S] &= ~R_V7M_CONTROL_FPCA_MASK;
 +                env->v7m.control[M_REG_S] |= val & R_V7M_CONTROL_FPCA_MASK;
 +            }
 +        }
          break;
      default:
-         g_assert_not_reached();
+     bad_reg:
@@ -XXX,XX +XXX,XX @@ static bool trans_ST1_zprz(DisasContext *s, arg_ST1_zprz *a, uint32_t insn)
      return true;
  }
 +static bool trans_ST1_zpiz(DisasContext *s, arg_ST1_zpiz *a, uint32_t insn)
 +{
 +    gen_helper_gvec_mem_scatter *fn = NULL;
 +    TCGv_i64 imm;
 +
 +    if (a->esz < a->msz) {
 +        return false;
 +    }
 +    if (!sve_access_check(s)) {
 +        return true;
 +    }
 +
 +    switch (a->esz) {
 +    case MO_32:
 +        fn = scatter_store_fn32[0][a->msz];
 +        break;
 +    case MO_64:
 +        fn = scatter_store_fn64[2][a->msz];
 +        break;
 +    }
 +    assert(fn != NULL);
 +
 +    /* Treat ST1_zpiz (zn[x] + imm) the same way as ST1_zprz (rn + zm[x])
 +     * by loading the immediate into the scalar parameter.
 +     */
 +    imm = tcg_const_i64(a->imm << a->msz);
 +    do_mem_zpz(s, a->rd, a->pg, a->rn, 0, imm, fn);
 +    tcg_temp_free_i64(imm);
 +    return true;
 +}
 +
  /*
   * Prefetches
   */
 diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve.decode
 +++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@
  &rprr_gather_load       rd pg rn rm esz msz u ff xs scale
  &rpri_gather_load       rd pg rn imm esz msz u ff
  &rprr_scatter_store     rd pg rn rm esz msz xs scale
 +&rpri_scatter_store     rd pg rn imm esz msz
  ###########################################################################
  # Named instruction formats.  These are generally used to
@@ -XXX,XX +XXX,XX @@
                      &rprr_store nreg=0
  @rprr_scatter_store ....... msz:2 ..     rm:5 ... pg:3 rn:5 rd:5 \
                      &rprr_scatter_store
 +@rpri_scatter_store ....... msz:2 ..    imm:5 ... pg:3 rn:5 rd:5 \
 +                    &rpri_scatter_store
  ###########################################################################
  # Instruction patterns.  Grouped according to the SVE encodingindex.xhtml.
@@ -XXX,XX +XXX,XX @@ ST1_zprz        1110010 .. 01 ..... 101 ... ..... ..... \
  ST1_zprz        1110010 .. 00 ..... 101 ... ..... ..... \
                  @rprr_scatter_store xs=2 esz=3 scale=0
 +# SVE 64-bit scatter store (vector plus immediate)
 +ST1_zpiz        1110010 .. 10 ..... 101 ... ..... ..... \
 +                @rpri_scatter_store esz=3
 +
 +# SVE 32-bit scatter store (vector plus immediate)
 +ST1_zpiz        1110010 .. 11 ..... 101 ... ..... ..... \
 +                @rpri_scatter_store esz=2
 +
  # SVE 64-bit scatter store (scalar plus unpacked 32-bit scaled offset)
  # Require msz > 0
  ST1_zprz        1110010 .. 01 ..... 100 ... ..... ..... \
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 42/55] target/arm: support reading of CNT[VCT|FRQ]_EL0 from user-space
+[Qemu-devel] [PULL 12/42] target/arm/helper: don't return early for STKOF faults during stacking
-From: Alex Bennée <alex.bennee@linaro.org>
+Currently the code in v7m_push_stack() which detects a violation
 of the v8M stack limit simply returns early if it does so. This
 is OK for the current integer-only code, but won't work for the
 floating point handling we're about to add. We need to continue
 executing the rest of the function so that we check for other
 exceptions like not having permission to use the FPU and so
 that we correctly set the FPCCR state if we are doing lazy
 stacking. Refactor to avoid the early return.
-Since kernel commit a86bd139f2 (arm64: arch_timer: Enable CNTVCT_EL0
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 trap..), released in kernel version v4.12, user-space has been able
 to read these system registers. As we can't use QEMUTimer's in
 linux-user mode we just directly call cpu_get_clock().
 Signed-off-by: Alex Bennée <alex.bennee@linaro.org>
 Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20180625160009.17437-2-alex.bennee@linaro.org
+Message-id: 20190416125744.27770-10-peter.maydell@linaro.org
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper.c | 27 ++++++++++++++++++++++++---
+ target/arm/helper.c | 23 ++++++++++++++++++-----
-file changed, 24 insertions(+), 3 deletions(-)
+file changed, 18 insertions(+), 5 deletions(-)
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo generic_timer_cp_reginfo[] = {
+@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
- };
+      * should ignore further stack faults trying to process
+      * that derived exception.)
- #else
+      */
--/* In user-mode none of the generic timer registers are accessible,
+-    bool stacked_ok;
-- * and their implementation depends on QEMU_CLOCK_VIRTUAL and qdev gpio outputs,
++    bool stacked_ok = true, limitviol = false;
-- * so instead just don't register any of them.
+     CPUARMState *env = &cpu->env;
-+
+     uint32_t xpsr = xpsr_read(env);
-+/* In user-mode most of the generic timer registers are inaccessible
+     uint32_t frameptr = env->regs[13];
-+ * however modern kernels (4.12+) allow access to cntvct_el0
+@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
-  */
+             armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE,
-+
+                                     env->v7m.secure);
-+static uint64_t gt_virt_cnt_read(CPUARMState *env, const ARMCPRegInfo *ri)
+             env->regs[13] = limit;
-+{
+-            return true;
-+    /* Currently we have no support for QEMUTimer in linux-user so we
++            /*
-+     * can't call gt_get_countervalue(env), instead we directly
++             * We won't try to perform any further memory accesses but
-+     * call the lower level functions.
++             * we must continue through the following code to check for
 +             * permission faults during FPU state preservation, and we
 +             * must update FPCCR if lazy stacking is enabled.
 +             */
 +            limitviol = true;
 +            stacked_ok = false;
          }
      }
@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
       * (which may be taken in preference to the one we started with
       * if it has higher priority).
       */
 -    stacked_ok =
 +    stacked_ok = stacked_ok &&
          v7m_stack_write(cpu, frameptr, env->regs[0], mmu_idx, false) &&
          v7m_stack_write(cpu, frameptr + 4, env->regs[1], mmu_idx, false) &&
          v7m_stack_write(cpu, frameptr + 8, env->regs[2], mmu_idx, false) &&
@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
          v7m_stack_write(cpu, frameptr + 24, env->regs[15], mmu_idx, false) &&
          v7m_stack_write(cpu, frameptr + 28, xpsr, mmu_idx, false);
 -    /* Update SP regardless of whether any of the stack accesses failed. */
 -    env->regs[13] = frameptr;
 +    /*
 +     * If we broke a stack limit then SP was already updated earlier;
 +     * otherwise we update SP regardless of whether any of the stack
 +     * accesses failed or we took some other kind of fault.
 +     */
-+    return cpu_get_clock() / GTIMER_SCALE;
++    if (!limitviol) {
-+}
++        env->regs[13] = frameptr;
-+
++    }
- static const ARMCPRegInfo generic_timer_cp_reginfo[] = {
-+    { .name = "CNTFRQ_EL0", .state = ARM_CP_STATE_AA64,
+     return !stacked_ok;
-+      .opc0 = 3, .opc1 = 3, .crn = 14, .crm = 0, .opc2 = 0,
+ }
 +      .type = ARM_CP_CONST, .access = PL0_R /* no PL1_RW in linux-user */,
 +      .fieldoffset = offsetof(CPUARMState, cp15.c14_cntfrq),
 +      .resetvalue = NANOSECONDS_PER_SECOND / GTIMER_SCALE,
 +    },
 +    { .name = "CNTVCT_EL0", .state = ARM_CP_STATE_AA64,
 +      .opc0 = 3, .opc1 = 3, .crn = 14, .crm = 0, .opc2 = 2,
 +      .access = PL0_R, .type = ARM_CP_NO_RAW | ARM_CP_IO,
 +      .readfn = gt_virt_cnt_read,
 +    },
      REGINFO_SENTINEL
  };
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 16/55] target/arm: Implement SVE store vector/predicate register
+[Qemu-devel] [PULL 13/42] target/arm: Handle floating point registers in exception entry
-From: Richard Henderson <richard.henderson@linaro.org>
+Handle floating point registers in exception entry.
 This corresponds to the FP-specific parts of the pseudocode
 functions ActivateException() and PushStack().
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+We defer the code corresponding to UpdateFPCCR() to a later patch.
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20180627043328.11531-11-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-11-peter.maydell@linaro.org
 ---
- target/arm/translate-sve.c | 103 +++++++++++++++++++++++++++++++++++++
+ target/arm/helper.c | 98 +++++++++++++++++++++++++++++++++++++++++++--
- target/arm/sve.decode      |   6 +++
+file changed, 95 insertions(+), 3 deletions(-)
 files changed, 109 insertions(+)
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
+--- a/target/arm/helper.c
-+++ b/target/arm/translate-sve.c
++++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ static void do_ldr(DisasContext *s, uint32_t vofs, uint32_t len,
+@@ -XXX,XX +XXX,XX @@ static void v7m_exception_taken(ARMCPU *cpu, uint32_t lr, bool dotailchain,
-     tcg_temp_free_i64(t0);
+     switch_v7m_security_state(env, targets_secure);
- }
+     write_v7m_control_spsel(env, 0);
+     arm_clear_exclusive(env);
-+/* Similarly for stores.  */
++    /* Clear SFPA and FPCA (has no effect if no FPU) */
-+static void do_str(DisasContext *s, uint32_t vofs, uint32_t len,
++    env->v7m.control[M_REG_S] &=
-+                   int rn, int imm)
++        ~(R_V7M_CONTROL_FPCA_MASK | R_V7M_CONTROL_SFPA_MASK);
-+{
+     /* Clear IT bits */
-+    uint32_t len_align = QEMU_ALIGN_DOWN(len, 8);
+     env->condexec_bits = 0;
-+    uint32_t len_remain = len % 8;
+     env->regs[14] = lr;
-+    uint32_t nparts = len / 8 + ctpop8(len_remain);
+@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
-+    int midx = get_mem_index(s);
+     uint32_t xpsr = xpsr_read(env);
-+    TCGv_i64 addr, t0;
+     uint32_t frameptr = env->regs[13];
      ARMMMUIdx mmu_idx = arm_mmu_idx(env);
 +    uint32_t framesize;
 +    bool nsacr_cp10 = extract32(env->v7m.nsacr, 10, 1);
 +
-+    addr = tcg_temp_new_i64();
++    if ((env->v7m.control[M_REG_S] & R_V7M_CONTROL_FPCA_MASK) &&
-+    t0 = tcg_temp_new_i64();
++        (env->v7m.secure || nsacr_cp10)) {
-+
++        if (env->v7m.secure &&
-+    /* Note that unpredicated load/store of vector/predicate registers
++            env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_TS_MASK) {
-+     * are defined as a stream of bytes, which equates to little-endian
++            framesize = 0xa8;
-+     * operations on larger quantities.  There is no nice way to force
++        } else {
-+     * a little-endian store for aarch64_be-linux-user out of line.
++            framesize = 0x68;
 +     *
 +     * Attempt to keep code expansion to a minimum by limiting the
 +     * amount of unrolling done.
 +     */
 +    if (nparts <= 4) {
 +        int i;
 +
 +        for (i = 0; i < len_align; i += 8) {
 +            tcg_gen_ld_i64(t0, cpu_env, vofs + i);
 +            tcg_gen_addi_i64(addr, cpu_reg_sp(s, rn), imm + i);
 +            tcg_gen_qemu_st_i64(t0, addr, midx, MO_LEQ);
 +        }
 +    } else {
-+        TCGLabel *loop = gen_new_label();
++        framesize = 0x20;
-+        TCGv_ptr t2, i = tcg_const_local_ptr(0);
++    }
-+
-+        gen_set_label(loop);
+     /* Align stack pointer if the guest wants that */
-+
+     if ((frameptr & 4) &&
-+        t2 = tcg_temp_new_ptr();
+@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
-+        tcg_gen_add_ptr(t2, cpu_env, i);
+         xpsr |= XPSR_SPREALIGN;
-+        tcg_gen_ld_i64(t0, t2, vofs);
+     }
-+
-+        /* Minimize the number of local temps that must be re-read from
+-    frameptr -= 0x20;
-+         * the stack each iteration.  Instead, re-compute values other
++    xpsr &= ~XPSR_SFPA;
-+         * than the loop counter.
++    if (env->v7m.secure &&
-+         */
++        (env->v7m.control[M_REG_S] & R_V7M_CONTROL_SFPA_MASK)) {
-+        tcg_gen_addi_ptr(t2, i, imm);
++        xpsr |= XPSR_SFPA;
 +        tcg_gen_extu_ptr_i64(addr, t2);
 +        tcg_gen_add_i64(addr, addr, cpu_reg_sp(s, rn));
 +        tcg_temp_free_ptr(t2);
 +
 +        tcg_gen_qemu_st_i64(t0, addr, midx, MO_LEQ);
 +
 +        tcg_gen_addi_ptr(i, i, 8);
 +
 +        tcg_gen_brcondi_ptr(TCG_COND_LTU, i, len_align, loop);
 +        tcg_temp_free_ptr(i);
 +    }
 +
-+    /* Predicate register stores can be any multiple of 2.  */
++    frameptr -= framesize;
-+    if (len_remain) {
-+        tcg_gen_ld_i64(t0, cpu_env, vofs + len_align);
+     if (arm_feature(env, ARM_FEATURE_V8)) {
-+        tcg_gen_addi_i64(addr, cpu_reg_sp(s, rn), imm + len_align);
+         uint32_t limit = v7m_sp_limit(env);
@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
          v7m_stack_write(cpu, frameptr + 24, env->regs[15], mmu_idx, false) &&
          v7m_stack_write(cpu, frameptr + 28, xpsr, mmu_idx, false);
 +    if (env->v7m.control[M_REG_S] & R_V7M_CONTROL_FPCA_MASK) {
 +        /* FPU is active, try to save its registers */
 +        bool fpccr_s = env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_S_MASK;
 +        bool lspact = env->v7m.fpccr[fpccr_s] & R_V7M_FPCCR_LSPACT_MASK;
 +
-+        switch (len_remain) {
++        if (lspact && arm_feature(env, ARM_FEATURE_M_SECURITY)) {
-+        case 2:
++            qemu_log_mask(CPU_LOG_INT,
-+        case 4:
++                          "...SecureFault because LSPACT and FPCA both set\n");
-+        case 8:
++            env->v7m.sfsr |= R_V7M_SFSR_LSERR_MASK;
-+            tcg_gen_qemu_st_i64(t0, addr, midx, MO_LE | ctz32(len_remain));
++            armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_SECURE, false);
-+            break;
++        } else if (!env->v7m.secure && !nsacr_cp10) {
 +            qemu_log_mask(CPU_LOG_INT,
 +                          "...Secure UsageFault with CFSR.NOCP because "
 +                          "NSACR.CP10 prevents stacking FP regs\n");
 +            armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE, M_REG_S);
 +            env->v7m.cfsr[M_REG_S] |= R_V7M_CFSR_NOCP_MASK;
 +        } else {
 +            if (!(env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_LSPEN_MASK)) {
 +                /* Lazy stacking disabled, save registers now */
 +                int i;
 +                bool cpacr_pass = v7m_cpacr_pass(env, env->v7m.secure,
 +                                                 arm_current_el(env) != 0);
 +
-+        case 6:
++                if (stacked_ok && !cpacr_pass) {
-+            tcg_gen_qemu_st_i64(t0, addr, midx, MO_LEUL);
++                    /*
-+            tcg_gen_addi_i64(addr, addr, 4);
++                     * Take UsageFault if CPACR forbids access. The pseudocode
-+            tcg_gen_shri_i64(t0, t0, 32);
++                     * here does a full CheckCPEnabled() but we know the NSACR
-+            tcg_gen_qemu_st_i64(t0, addr, midx, MO_LEUW);
++                     * check can never fail as we have already handled that.
-+            break;
++                     */
 +                    qemu_log_mask(CPU_LOG_INT,
 +                                  "...UsageFault with CFSR.NOCP because "
 +                                  "CPACR.CP10 prevents stacking FP regs\n");
 +                    armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE,
 +                                            env->v7m.secure);
 +                    env->v7m.cfsr[env->v7m.secure] |= R_V7M_CFSR_NOCP_MASK;
 +                    stacked_ok = false;
 +                }
 +
-+        default:
++                for (i = 0; i < ((framesize == 0xa8) ? 32 : 16); i += 2) {
-+            g_assert_not_reached();
++                    uint64_t dn = *aa32_vfp_dreg(env, i / 2);
 +                    uint32_t faddr = frameptr + 0x20 + 4 * i;
 +                    uint32_t slo = extract64(dn, 0, 32);
 +                    uint32_t shi = extract64(dn, 32, 32);
 +
 +                    if (i >= 16) {
 +                        faddr += 8; /* skip the slot for the FPSCR */
 +                    }
 +                    stacked_ok = stacked_ok &&
 +                        v7m_stack_write(cpu, faddr, slo, mmu_idx, false) &&
 +                        v7m_stack_write(cpu, faddr + 4, shi, mmu_idx, false);
 +                }
 +                stacked_ok = stacked_ok &&
 +                    v7m_stack_write(cpu, frameptr + 0x60,
 +                                    vfp_get_fpscr(env), mmu_idx, false);
 +                if (cpacr_pass) {
 +                    for (i = 0; i < ((framesize == 0xa8) ? 32 : 16); i += 2) {
 +                        *aa32_vfp_dreg(env, i / 2) = 0;
 +                    }
 +                    vfp_set_fpscr(env, 0);
 +                }
 +            } else {
 +                /* Lazy stacking enabled, save necessary info to stack later */
 +                /* TODO : equivalent of UpdateFPCCR() pseudocode */
 +            }
 +        }
 +    }
-+    tcg_temp_free_i64(addr);
-+    tcg_temp_free_i64(t0);
-+}
 +
- static bool trans_LDR_zri(DisasContext *s, arg_rri *a, uint32_t insn)
+     /*
- {
+      * If we broke a stack limit then SP was already updated earlier;
-     if (sve_access_check(s)) {
+      * otherwise we update SP regardless of whether any of the stack
-@@ -XXX,XX +XXX,XX @@ static bool trans_LDR_pri(DisasContext *s, arg_rri *a, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ void arm_v7m_cpu_do_interrupt(CPUState *cs)
-     return true;
- }
+     if (arm_feature(env, ARM_FEATURE_V8)) {
+         lr = R_V7M_EXCRET_RES1_MASK |
-+static bool trans_STR_zri(DisasContext *s, arg_rri *a, uint32_t insn)
+-            R_V7M_EXCRET_DCRS_MASK |
-+{
+-            R_V7M_EXCRET_FTYPE_MASK;
-+    if (sve_access_check(s)) {
++            R_V7M_EXCRET_DCRS_MASK;
-+        int size = vec_full_reg_size(s);
+         /* The S bit indicates whether we should return to Secure
-+        int off = vec_full_reg_offset(s, a->rd);
+          * or NonSecure (ie our current state).
-+        do_str(s, off, size, a->rn, a->imm * size);
+          * The ES bit indicates whether we're taking this exception
-+    }
+@@ -XXX,XX +XXX,XX @@ void arm_v7m_cpu_do_interrupt(CPUState *cs)
-+    return true;
+         if (env->v7m.secure) {
-+}
+             lr |= R_V7M_EXCRET_S_MASK;
-+
+         }
-+static bool trans_STR_pri(DisasContext *s, arg_rri *a, uint32_t insn)
++        if (!(env->v7m.control[M_REG_S] & R_V7M_CONTROL_FPCA_MASK)) {
-+{
++            lr |= R_V7M_EXCRET_FTYPE_MASK;
-+    if (sve_access_check(s)) {
++        }
-+        int size = pred_full_reg_size(s);
+     } else {
-+        int off = pred_full_reg_offset(s, a->rd);
+         lr = R_V7M_EXCRET_RES1_MASK |
-+        do_str(s, off, size, a->rn, a->imm * size);
+             R_V7M_EXCRET_S_MASK |
 +    }
 +    return true;
 +}
 +
  /*
   *** SVE Memory - Contiguous Load Group
   */
 diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve.decode
 +++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@ LD1RQ_zpri      1010010 .. 00 0.... 001 ... ..... ..... \
  ### SVE Memory Store Group
 +# SVE store predicate register
 +STR_pri         1110010 11 0.     ..... 000 ... ..... 0 ....    @pd_rn_i9
 +
 +# SVE store vector register
 +STR_zri         1110010 11 0.     ..... 010 ... ..... .....     @rd_rn_i9
 +
  # SVE contiguous store (scalar plus immediate)
  # ST1B, ST1H, ST1W, ST1D; require msz <= esz
  ST_zpri         1110010 .. esz:2  0.... 111 ... ..... ..... \
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 33/55] target/arm: Implement SVE MOVPRFX
+[Qemu-devel] [PULL 14/42] target/arm: Implement v7m_update_fpccr()
-From: Richard Henderson <richard.henderson@linaro.org>
+Implement the code which updates the FPCCR register on an
 exception entry where we are going to use lazy FP stacking.
 We have to defer to the NVIC to determine whether the
 various exceptions are currently ready or not.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20180627043328.11531-28-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Message-id: 20190416125744.27770-12-peter.maydell@linaro.org
 ---
- target/arm/translate-sve.c | 60 +++++++++++++++++++++++++++++++++++++-
+ target/arm/cpu.h      | 14 +++++++++
- target/arm/sve.decode      |  7 +++++
+ hw/intc/armv7m_nvic.c | 34 ++++++++++++++++++++++
-files changed, 66 insertions(+), 1 deletion(-)
+ target/arm/helper.c   | 67 ++++++++++++++++++++++++++++++++++++++++++-
 files changed, 114 insertions(+), 1 deletion(-)
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+diff --git a/target/arm/cpu.h b/target/arm/cpu.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
+--- a/target/arm/cpu.h
-+++ b/target/arm/translate-sve.c
++++ b/target/arm/cpu.h
-@@ -XXX,XX +XXX,XX @@ static bool do_zpzz_ool(DisasContext *s, arg_rprr_esz *a, gen_helper_gvec_4 *fn)
+@@ -XXX,XX +XXX,XX @@ void armv7m_nvic_acknowledge_irq(void *opaque);
-     return true;
+  * (Ignoring -1, this is the same as the RETTOBASE value before completion.)
   */
  int armv7m_nvic_complete_irq(void *opaque, int irq, bool secure);
 +/**
 + * armv7m_nvic_get_ready_status(void *opaque, int irq, bool secure)
 + * @opaque: the NVIC
 + * @irq: the exception number to mark pending
 + * @secure: false for non-banked exceptions or for the nonsecure
 + * version of a banked exception, true for the secure version of a banked
 + * exception.
 + *
 + * Return whether an exception is "ready", i.e. whether the exception is
 + * enabled and is configured at a priority which would allow it to
 + * interrupt the current execution priority. This controls whether the
 + * RDY bit for it in the FPCCR is set.
 + */
 +bool armv7m_nvic_get_ready_status(void *opaque, int irq, bool secure);
  /**
   * armv7m_nvic_raw_execution_priority: return the raw execution priority
   * @opaque: the NVIC
 diff --git a/hw/intc/armv7m_nvic.c b/hw/intc/armv7m_nvic.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/intc/armv7m_nvic.c
 +++ b/hw/intc/armv7m_nvic.c
@@ -XXX,XX +XXX,XX @@ int armv7m_nvic_complete_irq(void *opaque, int irq, bool secure)
      return ret;
  }
-+/* Select active elememnts from Zn and inactive elements from Zm,
++bool armv7m_nvic_get_ready_status(void *opaque, int irq, bool secure)
 + * storing the result in Zd.
 + */
 +static void do_sel_z(DisasContext *s, int rd, int rn, int rm, int pg, int esz)
 +{
-+    static gen_helper_gvec_4 * const fns[4] = {
++    /*
-+        gen_helper_sve_sel_zpzz_b, gen_helper_sve_sel_zpzz_h,
++     * Return whether an exception is "ready", i.e. it is enabled and is
-+        gen_helper_sve_sel_zpzz_s, gen_helper_sve_sel_zpzz_d
++     * configured at a priority which would allow it to interrupt the
-+    };
++     * current execution priority.
-+    unsigned vsz = vec_full_reg_size(s);
++     *
-+    tcg_gen_gvec_4_ool(vec_full_reg_offset(s, rd),
++     * irq and secure have the same semantics as for armv7m_nvic_set_pending():
-+                       vec_full_reg_offset(s, rn),
++     * for non-banked exceptions secure is always false; for banked exceptions
-+                       vec_full_reg_offset(s, rm),
++     * it indicates which of the exceptions is required.
-+                       pred_full_reg_offset(s, pg),
++     */
-+                       vsz, vsz, 0, fns[esz]);
++    NVICState *s = (NVICState *)opaque;
 +    bool banked = exc_is_banked(irq);
 +    VecInfo *vec;
 +    int running = nvic_exec_prio(s);
 +
 +    assert(irq > ARMV7M_EXCP_RESET && irq < s->num_irq);
 +    assert(!secure || banked);
 +
 +    /*
 +     * HardFault is an odd special case: we always check against -1,
 +     * even if we're secure and HardFault has priority -3; we never
 +     * need to check for enabled state.
 +     */
 +    if (irq == ARMV7M_EXCP_HARD) {
 +        return running > -1;
 +    }
 +
 +    vec = (banked && secure) ? &s->sec_vectors[irq] : &s->vectors[irq];
 +
 +    return vec->enabled &&
 +        exc_group_prio(s, vec->prio, secure) < running;
 +}
 +
- #define DO_ZPZZ(NAME, name) \
+ /* callback when external interrupt line is changed */
- static bool trans_##NAME##_zpzz(DisasContext *s, arg_rprr_esz *a,         \
+ static void set_irq_level(void *opaque, int n, int level)
-                                 uint32_t insn)                            \
+ {
-@@ -XXX,XX +XXX,XX @@ static bool trans_UDIV_zpzz(DisasContext *s, arg_rprr_esz *a, uint32_t insn)
+diff --git a/target/arm/helper.c b/target/arm/helper.c
-     return do_zpzz_ool(s, a, fns[a->esz]);
+index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void v7m_exception_taken(ARMCPU *cpu, uint32_t lr, bool dotailchain,
      env->thumb = addr & 1;
  }
--DO_ZPZZ(SEL, sel)
++static void v7m_update_fpccr(CPUARMState *env, uint32_t frameptr,
-+static bool trans_SEL_zpzz(DisasContext *s, arg_rprr_esz *a, uint32_t insn)
++                             bool apply_splim)
 +{
-+    if (sve_access_check(s)) {
++    /*
-+        do_sel_z(s, a->rd, a->rn, a->rm, a->pg, a->esz);
++     * Like the pseudocode UpdateFPCCR: save state in FPCAR and FPCCR
 +     * that we will need later in order to do lazy FP reg stacking.
 +     */
 +    bool is_secure = env->v7m.secure;
 +    void *nvic = env->nvic;
 +    /*
 +     * Some bits are unbanked and live always in fpccr[M_REG_S]; some bits
 +     * are banked and we want to update the bit in the bank for the
 +     * current security state; and in one case we want to specifically
 +     * update the NS banked version of a bit even if we are secure.
 +     */
 +    uint32_t *fpccr_s = &env->v7m.fpccr[M_REG_S];
 +    uint32_t *fpccr_ns = &env->v7m.fpccr[M_REG_NS];
 +    uint32_t *fpccr = &env->v7m.fpccr[is_secure];
 +    bool hfrdy, bfrdy, mmrdy, ns_ufrdy, s_ufrdy, sfrdy, monrdy;
 +
 +    env->v7m.fpcar[is_secure] = frameptr & ~0x7;
 +
 +    if (apply_splim && arm_feature(env, ARM_FEATURE_V8)) {
 +        bool splimviol;
 +        uint32_t splim = v7m_sp_limit(env);
 +        bool ign = armv7m_nvic_neg_prio_requested(nvic, is_secure) &&
 +            (env->v7m.ccr[is_secure] & R_V7M_CCR_STKOFHFNMIGN_MASK);
 +
 +        splimviol = !ign && frameptr < splim;
 +        *fpccr = FIELD_DP32(*fpccr, V7M_FPCCR, SPLIMVIOL, splimviol);
 +    }
-+    return true;
-+}
- #undef DO_ZPZZ
-@@ -XXX,XX +XXX,XX @@ static bool trans_PRF_rr(DisasContext *s, arg_PRF_rr *a, uint32_t insn)
-     sve_access_check(s);
-     return true;
- }
 +
-+/*
++    *fpccr = FIELD_DP32(*fpccr, V7M_FPCCR, LSPACT, 1);
 + * Move Prefix
 + *
 + * TODO: The implementation so far could handle predicated merging movprfx.
 + * The helper functions as written take an extra source register to
 + * use in the operation, but the result is only written when predication
 + * succeeds.  For unpredicated movprfx, we need to rearrange the helpers
 + * to allow the final write back to the destination to be unconditional.
 + * For predicated zeroing movprfx, we need to rearrange the helpers to
 + * allow the final write back to zero inactives.
 + *
 + * In the meantime, just emit the moves.
 + */
 +
-+static bool trans_MOVPRFX(DisasContext *s, arg_MOVPRFX *a, uint32_t insn)
++    *fpccr_s = FIELD_DP32(*fpccr_s, V7M_FPCCR, S, is_secure);
-+{
++
-+    return do_mov_z(s, a->rd, a->rn);
++    *fpccr = FIELD_DP32(*fpccr, V7M_FPCCR, USER, arm_current_el(env) == 0);
 +
 +    *fpccr = FIELD_DP32(*fpccr, V7M_FPCCR, THREAD,
 +                        !arm_v7m_is_handler_mode(env));
 +
 +    hfrdy = armv7m_nvic_get_ready_status(nvic, ARMV7M_EXCP_HARD, false);
 +    *fpccr_s = FIELD_DP32(*fpccr_s, V7M_FPCCR, HFRDY, hfrdy);
 +
 +    bfrdy = armv7m_nvic_get_ready_status(nvic, ARMV7M_EXCP_BUS, false);
 +    *fpccr_s = FIELD_DP32(*fpccr_s, V7M_FPCCR, BFRDY, bfrdy);
 +
 +    mmrdy = armv7m_nvic_get_ready_status(nvic, ARMV7M_EXCP_MEM, is_secure);
 +    *fpccr = FIELD_DP32(*fpccr, V7M_FPCCR, MMRDY, mmrdy);
 +
 +    ns_ufrdy = armv7m_nvic_get_ready_status(nvic, ARMV7M_EXCP_USAGE, false);
 +    *fpccr_ns = FIELD_DP32(*fpccr_ns, V7M_FPCCR, UFRDY, ns_ufrdy);
 +
 +    monrdy = armv7m_nvic_get_ready_status(nvic, ARMV7M_EXCP_DEBUG, false);
 +    *fpccr_s = FIELD_DP32(*fpccr_s, V7M_FPCCR, MONRDY, monrdy);
 +
 +    if (arm_feature(env, ARM_FEATURE_M_SECURITY)) {
 +        s_ufrdy = armv7m_nvic_get_ready_status(nvic, ARMV7M_EXCP_USAGE, true);
 +        *fpccr_s = FIELD_DP32(*fpccr_s, V7M_FPCCR, UFRDY, s_ufrdy);
 +
 +        sfrdy = armv7m_nvic_get_ready_status(nvic, ARMV7M_EXCP_SECURE, false);
 +        *fpccr_s = FIELD_DP32(*fpccr_s, V7M_FPCCR, SFRDY, sfrdy);
 +    }
 +}
 +
-+static bool trans_MOVPRFX_m(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
+ static bool v7m_push_stack(ARMCPU *cpu)
-+{
+ {
-+    if (sve_access_check(s)) {
+     /* Do the "set up stack frame" part of exception entry,
-+        do_sel_z(s, a->rd, a->rn, a->rd, a->pg, a->esz);
+@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
-+    }
+                 }
-+    return true;
+             } else {
-+}
+                 /* Lazy stacking enabled, save necessary info to stack later */
-+
+-                /* TODO : equivalent of UpdateFPCCR() pseudocode */
-+static bool trans_MOVPRFX_z(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
++                v7m_update_fpccr(env, frameptr + 0x20, true);
-+{
+             }
-+    if (sve_access_check(s)) {
+         }
-+        do_movz_zpz(s, a->rd, a->rn, a->pg, a->esz);
+     }
 +    }
 +    return true;
 +}
 diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve.decode
 +++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@ ORV             00000100 .. 011 000 001 ... ..... .....         @rd_pg_rn
  EORV            00000100 .. 011 001 001 ... ..... .....         @rd_pg_rn
  ANDV            00000100 .. 011 010 001 ... ..... .....         @rd_pg_rn
 +# SVE constructive prefix (predicated)
 +MOVPRFX_z       00000100 .. 010 000 001 ... ..... .....         @rd_pg_rn
 +MOVPRFX_m       00000100 .. 010 001 001 ... ..... .....         @rd_pg_rn
 +
  # SVE integer add reduction (predicated)
  # Note that saddv requires size != 3.
  UADDV           00000100 .. 000 001 001 ... ..... .....         @rd_pg_rn
@@ -XXX,XX +XXX,XX @@ ADR_p64         00000100 11 1 ..... 1010 .. ..... .....         @rd_rn_msz_rm
  ### SVE Integer Misc - Unpredicated Group
 +# SVE constructive prefix (unpredicated)
 +MOVPRFX         00000100 00 1 00000 101111 rn:5 rd:5
 +
  # SVE floating-point exponential accelerator
  # Note esz != 0
  FEXPA           00000100 .. 1 00000 101110 ..... .....          @rd_rn
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 48/55] target/arm: Mark PMINTENSET accesses as possibly doing IO
+[Qemu-devel] [PULL 15/42] target/arm: Clear CONTROL.SFPA in BXNS and BLXNS
-From: Aaron Lindsay <alindsay@codeaurora.org>
+For v8M floating point support, transitions from Secure
 to Non-secure state via BLNS and BLXNS must clear the
 CONTROL.SFPA bit. (This corresponds to the pseudocode
 BranchToNS() function.)
-This makes it match its AArch64 equivalent, PMINTENSET_EL1
-Signed-off-by: Aaron Lindsay <alindsay@codeaurora.org>
-Message-id: 1529699547-17044-13-git-send-email-alindsay@codeaurora.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-13-peter.maydell@linaro.org
 ---
- target/arm/helper.c | 2 +-
+ target/arm/helper.c | 4 ++++
-file changed, 1 insertion(+), 1 deletion(-)
+file changed, 4 insertions(+)
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo v7_cp_reginfo[] = {
+@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_bxns)(CPUARMState *env, uint32_t dest)
-       .writefn = pmuserenr_write, .raw_writefn = raw_write },
+     /* translate.c should have made BXNS UNDEF unless we're secure */
-     { .name = "PMINTENSET", .cp = 15, .crn = 9, .crm = 14, .opc1 = 0, .opc2 = 1,
+     assert(env->v7m.secure);
-       .access = PL1_RW, .accessfn = access_tpm,
--      .type = ARM_CP_ALIAS,
++    if (!(dest & 1)) {
-+      .type = ARM_CP_ALIAS | ARM_CP_IO,
++        env->v7m.control[M_REG_S] &= ~R_V7M_CONTROL_SFPA_MASK;
-       .fieldoffset = offsetoflow32(CPUARMState, cp15.c9_pminten),
++    }
-       .resetvalue = 0,
+     switch_v7m_security_state(env, dest & 1);
-       .writefn = pmintenset_write, .raw_writefn = raw_write },
+     env->thumb = 1;
      env->regs[15] = dest & ~1;
@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_blxns)(CPUARMState *env, uint32_t dest)
           */
          write_v7m_exception(env, 1);
      }
 +    env->v7m.control[M_REG_S] &= ~R_V7M_CONTROL_SFPA_MASK;
      switch_v7m_security_state(env, 0);
      env->thumb = 1;
      env->regs[15] = dest;
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 13/55] target/arm: Implement SVE FP Multiply-Add Group
+[Qemu-devel] [PULL 16/42] target/arm: Clean excReturn bits when tail chaining
-From: Richard Henderson <richard.henderson@linaro.org>
+The TailChain() pseudocode specifies that a tail chaining
 exception should sanitize the excReturn all-ones bits and
 (if there is no FPU) the excReturn FType bits; we weren't
 doing this.
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Reviewed-by: Alex Bennée <alex.bennee@linaro.org>
-Message-id: 20180627043328.11531-8-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-14-peter.maydell@linaro.org
 ---
- target/arm/helper-sve.h    |  16 ++++
+ target/arm/helper.c | 8 ++++++++
- target/arm/sve_helper.c    | 158 +++++++++++++++++++++++++++++++++++++
+file changed, 8 insertions(+)
  target/arm/translate-sve.c |  49 ++++++++++++
  target/arm/sve.decode      |  18 +++++
 files changed, 241 insertions(+)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
+diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
+--- a/target/arm/helper.c
-+++ b/target/arm/helper-sve.h
++++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_5(sve_ucvt_ds, TCG_CALL_NO_RWG,
+@@ -XXX,XX +XXX,XX @@ static void v7m_exception_taken(ARMCPU *cpu, uint32_t lr, bool dotailchain,
- DEF_HELPER_FLAGS_5(sve_ucvt_dd, TCG_CALL_NO_RWG,
+     qemu_log_mask(CPU_LOG_INT, "...taking pending %s exception %d\n",
-                    void, ptr, ptr, ptr, ptr, i32)
+                   targets_secure ? "secure" : "nonsecure", exc);
-+DEF_HELPER_FLAGS_3(sve_fmla_zpzzz_h, TCG_CALL_NO_RWG, void, env, ptr, i32)
++    if (dotailchain) {
-+DEF_HELPER_FLAGS_3(sve_fmla_zpzzz_s, TCG_CALL_NO_RWG, void, env, ptr, i32)
++        /* Sanitize LR FType and PREFIX bits */
-+DEF_HELPER_FLAGS_3(sve_fmla_zpzzz_d, TCG_CALL_NO_RWG, void, env, ptr, i32)
++        if (!arm_feature(env, ARM_FEATURE_VFP)) {
-+
++            lr |= R_V7M_EXCRET_FTYPE_MASK;
-+DEF_HELPER_FLAGS_3(sve_fmls_zpzzz_h, TCG_CALL_NO_RWG, void, env, ptr, i32)
++        }
-+DEF_HELPER_FLAGS_3(sve_fmls_zpzzz_s, TCG_CALL_NO_RWG, void, env, ptr, i32)
++        lr = deposit32(lr, 24, 8, 0xff);
 +DEF_HELPER_FLAGS_3(sve_fmls_zpzzz_d, TCG_CALL_NO_RWG, void, env, ptr, i32)
 +
 +DEF_HELPER_FLAGS_3(sve_fnmla_zpzzz_h, TCG_CALL_NO_RWG, void, env, ptr, i32)
 +DEF_HELPER_FLAGS_3(sve_fnmla_zpzzz_s, TCG_CALL_NO_RWG, void, env, ptr, i32)
 +DEF_HELPER_FLAGS_3(sve_fnmla_zpzzz_d, TCG_CALL_NO_RWG, void, env, ptr, i32)
 +
 +DEF_HELPER_FLAGS_3(sve_fnmls_zpzzz_h, TCG_CALL_NO_RWG, void, env, ptr, i32)
 +DEF_HELPER_FLAGS_3(sve_fnmls_zpzzz_s, TCG_CALL_NO_RWG, void, env, ptr, i32)
 +DEF_HELPER_FLAGS_3(sve_fnmls_zpzzz_d, TCG_CALL_NO_RWG, void, env, ptr, i32)
 +
  DEF_HELPER_FLAGS_4(sve_ld1bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
  DEF_HELPER_FLAGS_4(sve_ld2bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
  DEF_HELPER_FLAGS_4(sve_ld3bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve_helper.c
 +++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ DO_ZPZ_FP(sve_ucvt_dd, uint64_t,     , uint64_to_float64)
  #undef DO_ZPZ_FP
 +/* 4-operand predicated multiply-add.  This requires 7 operands to pass
 + * "properly", so we need to encode some of the registers into DESC.
 + */
 +QEMU_BUILD_BUG_ON(SIMD_DATA_SHIFT + 20 > 32);
 +
 +static void do_fmla_zpzzz_h(CPUARMState *env, void *vg, uint32_t desc,
 +                            uint16_t neg1, uint16_t neg3)
 +{
 +    intptr_t i = simd_oprsz(desc);
 +    unsigned rd = extract32(desc, SIMD_DATA_SHIFT, 5);
 +    unsigned rn = extract32(desc, SIMD_DATA_SHIFT + 5, 5);
 +    unsigned rm = extract32(desc, SIMD_DATA_SHIFT + 10, 5);
 +    unsigned ra = extract32(desc, SIMD_DATA_SHIFT + 15, 5);
 +    void *vd = &env->vfp.zregs[rd];
 +    void *vn = &env->vfp.zregs[rn];
 +    void *vm = &env->vfp.zregs[rm];
 +    void *va = &env->vfp.zregs[ra];
 +    uint64_t *g = vg;
 +
 +    do {
 +        uint64_t pg = g[(i - 1) >> 6];
 +        do {
 +            i -= 2;
 +            if (likely((pg >> (i & 63)) & 1)) {
 +                float16 e1, e2, e3, r;
 +
 +                e1 = *(uint16_t *)(vn + H1_2(i)) ^ neg1;
 +                e2 = *(uint16_t *)(vm + H1_2(i));
 +                e3 = *(uint16_t *)(va + H1_2(i)) ^ neg3;
 +                r = float16_muladd(e1, e2, e3, 0, &env->vfp.fp_status);
 +                *(uint16_t *)(vd + H1_2(i)) = r;
 +            }
 +        } while (i & 63);
 +    } while (i != 0);
 +}
 +
 +void HELPER(sve_fmla_zpzzz_h)(CPUARMState *env, void *vg, uint32_t desc)
 +{
 +    do_fmla_zpzzz_h(env, vg, desc, 0, 0);
 +}
 +
 +void HELPER(sve_fmls_zpzzz_h)(CPUARMState *env, void *vg, uint32_t desc)
 +{
 +    do_fmla_zpzzz_h(env, vg, desc, 0x8000, 0);
 +}
 +
 +void HELPER(sve_fnmla_zpzzz_h)(CPUARMState *env, void *vg, uint32_t desc)
 +{
 +    do_fmla_zpzzz_h(env, vg, desc, 0x8000, 0x8000);
 +}
 +
 +void HELPER(sve_fnmls_zpzzz_h)(CPUARMState *env, void *vg, uint32_t desc)
 +{
 +    do_fmla_zpzzz_h(env, vg, desc, 0, 0x8000);
 +}
 +
 +static void do_fmla_zpzzz_s(CPUARMState *env, void *vg, uint32_t desc,
 +                            uint32_t neg1, uint32_t neg3)
 +{
 +    intptr_t i = simd_oprsz(desc);
 +    unsigned rd = extract32(desc, SIMD_DATA_SHIFT, 5);
 +    unsigned rn = extract32(desc, SIMD_DATA_SHIFT + 5, 5);
 +    unsigned rm = extract32(desc, SIMD_DATA_SHIFT + 10, 5);
 +    unsigned ra = extract32(desc, SIMD_DATA_SHIFT + 15, 5);
 +    void *vd = &env->vfp.zregs[rd];
 +    void *vn = &env->vfp.zregs[rn];
 +    void *vm = &env->vfp.zregs[rm];
 +    void *va = &env->vfp.zregs[ra];
 +    uint64_t *g = vg;
 +
 +    do {
 +        uint64_t pg = g[(i - 1) >> 6];
 +        do {
 +            i -= 4;
 +            if (likely((pg >> (i & 63)) & 1)) {
 +                float32 e1, e2, e3, r;
 +
 +                e1 = *(uint32_t *)(vn + H1_4(i)) ^ neg1;
 +                e2 = *(uint32_t *)(vm + H1_4(i));
 +                e3 = *(uint32_t *)(va + H1_4(i)) ^ neg3;
 +                r = float32_muladd(e1, e2, e3, 0, &env->vfp.fp_status);
 +                *(uint32_t *)(vd + H1_4(i)) = r;
 +            }
 +        } while (i & 63);
 +    } while (i != 0);
 +}
 +
 +void HELPER(sve_fmla_zpzzz_s)(CPUARMState *env, void *vg, uint32_t desc)
 +{
 +    do_fmla_zpzzz_s(env, vg, desc, 0, 0);
 +}
 +
 +void HELPER(sve_fmls_zpzzz_s)(CPUARMState *env, void *vg, uint32_t desc)
 +{
 +    do_fmla_zpzzz_s(env, vg, desc, 0x80000000, 0);
 +}
 +
 +void HELPER(sve_fnmla_zpzzz_s)(CPUARMState *env, void *vg, uint32_t desc)
 +{
 +    do_fmla_zpzzz_s(env, vg, desc, 0x80000000, 0x80000000);
 +}
 +
 +void HELPER(sve_fnmls_zpzzz_s)(CPUARMState *env, void *vg, uint32_t desc)
 +{
 +    do_fmla_zpzzz_s(env, vg, desc, 0, 0x80000000);
 +}
 +
 +static void do_fmla_zpzzz_d(CPUARMState *env, void *vg, uint32_t desc,
 +                            uint64_t neg1, uint64_t neg3)
 +{
 +    intptr_t i = simd_oprsz(desc);
 +    unsigned rd = extract32(desc, SIMD_DATA_SHIFT, 5);
 +    unsigned rn = extract32(desc, SIMD_DATA_SHIFT + 5, 5);
 +    unsigned rm = extract32(desc, SIMD_DATA_SHIFT + 10, 5);
 +    unsigned ra = extract32(desc, SIMD_DATA_SHIFT + 15, 5);
 +    void *vd = &env->vfp.zregs[rd];
 +    void *vn = &env->vfp.zregs[rn];
 +    void *vm = &env->vfp.zregs[rm];
 +    void *va = &env->vfp.zregs[ra];
 +    uint64_t *g = vg;
 +
 +    do {
 +        uint64_t pg = g[(i - 1) >> 6];
 +        do {
 +            i -= 8;
 +            if (likely((pg >> (i & 63)) & 1)) {
 +                float64 e1, e2, e3, r;
 +
 +                e1 = *(uint64_t *)(vn + i) ^ neg1;
 +                e2 = *(uint64_t *)(vm + i);
 +                e3 = *(uint64_t *)(va + i) ^ neg3;
 +                r = float64_muladd(e1, e2, e3, 0, &env->vfp.fp_status);
 +                *(uint64_t *)(vd + i) = r;
 +            }
 +        } while (i & 63);
 +    } while (i != 0);
 +}
 +
 +void HELPER(sve_fmla_zpzzz_d)(CPUARMState *env, void *vg, uint32_t desc)
 +{
 +    do_fmla_zpzzz_d(env, vg, desc, 0, 0);
 +}
 +
 +void HELPER(sve_fmls_zpzzz_d)(CPUARMState *env, void *vg, uint32_t desc)
 +{
 +    do_fmla_zpzzz_d(env, vg, desc, INT64_MIN, 0);
 +}
 +
 +void HELPER(sve_fnmla_zpzzz_d)(CPUARMState *env, void *vg, uint32_t desc)
 +{
 +    do_fmla_zpzzz_d(env, vg, desc, INT64_MIN, INT64_MIN);
 +}
 +
 +void HELPER(sve_fnmls_zpzzz_d)(CPUARMState *env, void *vg, uint32_t desc)
 +{
 +    do_fmla_zpzzz_d(env, vg, desc, 0, INT64_MIN);
 +}
 +
  /*
   * Load contiguous data, protected by a governing predicate.
   */
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-sve.c
 +++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ DO_FP3(FMULX, fmulx)
  #undef DO_FP3
 +typedef void gen_helper_sve_fmla(TCGv_env, TCGv_ptr, TCGv_i32);
 +
 +static bool do_fmla(DisasContext *s, arg_rprrr_esz *a, gen_helper_sve_fmla *fn)
 +{
 +    if (fn == NULL) {
 +        return false;
 +    }
 +    if (!sve_access_check(s)) {
 +        return true;
 +    }
 +
-+    unsigned vsz = vec_full_reg_size(s);
+     if (arm_feature(env, ARM_FEATURE_V8)) {
-+    unsigned desc;
+         if (arm_feature(env, ARM_FEATURE_M_SECURITY) &&
-+    TCGv_i32 t_desc;
+             (lr & R_V7M_EXCRET_S_MASK)) {
 +    TCGv_ptr pg = tcg_temp_new_ptr();
 +
 +    /* We would need 7 operands to pass these arguments "properly".
 +     * So we encode all the register numbers into the descriptor.
 +     */
 +    desc = deposit32(a->rd, 5, 5, a->rn);
 +    desc = deposit32(desc, 10, 5, a->rm);
 +    desc = deposit32(desc, 15, 5, a->ra);
 +    desc = simd_desc(vsz, vsz, desc);
 +
 +    t_desc = tcg_const_i32(desc);
 +    tcg_gen_addi_ptr(pg, cpu_env, pred_full_reg_offset(s, a->pg));
 +    fn(cpu_env, pg, t_desc);
 +    tcg_temp_free_i32(t_desc);
 +    tcg_temp_free_ptr(pg);
 +    return true;
 +}
 +
 +#define DO_FMLA(NAME, name) \
 +static bool trans_##NAME(DisasContext *s, arg_rprrr_esz *a, uint32_t insn) \
 +{                                                                    \
 +    static gen_helper_sve_fmla * const fns[4] = {                    \
 +        NULL, gen_helper_sve_##name##_h,                             \
 +        gen_helper_sve_##name##_s, gen_helper_sve_##name##_d         \
 +    };                                                               \
 +    return do_fmla(s, a, fns[a->esz]);                               \
 +}
 +
 +DO_FMLA(FMLA_zpzzz, fmla_zpzzz)
 +DO_FMLA(FMLS_zpzzz, fmls_zpzzz)
 +DO_FMLA(FNMLA_zpzzz, fnmla_zpzzz)
 +DO_FMLA(FNMLS_zpzzz, fnmls_zpzzz)
 +
 +#undef DO_FMLA
 +
  /*
   *** SVE Floating Point Unary Operations Predicated Group
   */
 diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve.decode
 +++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@
                  &rprrr_esz ra=%reg_movprfx
  @rdn_pg_ra_rm   ........ esz:2 . rm:5  ... pg:3 ra:5 rd:5 \
                  &rprrr_esz rn=%reg_movprfx
 +@rdn_pg_rm_ra   ........ esz:2 . ra:5  ... pg:3 rm:5 rd:5 \
 +                &rprrr_esz rn=%reg_movprfx
  # One register operand, with governing predicate, vector element size
  @rd_pg_rn       ........ esz:2 ... ... ... pg:3 rn:5 rd:5       &rpr_esz
@@ -XXX,XX +XXX,XX @@ FMULX           01100101 .. 00 1010 100 ... ..... .....    @rdn_pg_rm
  FDIV            01100101 .. 00 1100 100 ... ..... .....    @rdm_pg_rn # FDIVR
  FDIV            01100101 .. 00 1101 100 ... ..... .....    @rdn_pg_rm
 +### SVE FP Multiply-Add Group
 +
 +# SVE floating-point multiply-accumulate writing addend
 +FMLA_zpzzz      01100101 .. 1 ..... 000 ... ..... .....         @rda_pg_rn_rm
 +FMLS_zpzzz      01100101 .. 1 ..... 001 ... ..... .....         @rda_pg_rn_rm
 +FNMLA_zpzzz     01100101 .. 1 ..... 010 ... ..... .....         @rda_pg_rn_rm
 +FNMLS_zpzzz     01100101 .. 1 ..... 011 ... ..... .....         @rda_pg_rn_rm
 +
 +# SVE floating-point multiply-accumulate writing multiplicand
 +# Alter the operand extraction order and reuse the helpers from above.
 +# FMAD, FMSB, FNMAD, FNMS
 +FMLA_zpzzz      01100101 .. 1 ..... 100 ... ..... .....         @rdn_pg_rm_ra
 +FMLS_zpzzz      01100101 .. 1 ..... 101 ... ..... .....         @rdn_pg_rm_ra
 +FNMLA_zpzzz     01100101 .. 1 ..... 110 ... ..... .....         @rdn_pg_rm_ra
 +FNMLS_zpzzz     01100101 .. 1 ..... 111 ... ..... .....         @rdn_pg_rm_ra
 +
  ### SVE FP Unary Operations Predicated Group
  # SVE integer convert to floating-point
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 37/55] target/arm: Implement SVE fp complex multiply add (indexed)
+[Qemu-devel] [PULL 17/42] target/arm: Allow for floating point in callee stack integrity check
-From: Richard Henderson <richard.henderson@linaro.org>
+The magic value pushed onto the callee stack as an integrity
 check is different if floating point is present.
-Enhance the existing helpers to support SVE, which takes the
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-index from each 128-bit segment.  The change has no effect
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
-for AdvSIMD, since there is only one such segment.
+Message-id: 20190416125744.27770-15-peter.maydell@linaro.org
 ---
  target/arm/helper.c | 22 +++++++++++++++++++---
 file changed, 19 insertions(+), 3 deletions(-)
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+diff --git a/target/arm/helper.c b/target/arm/helper.c
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Alex Bennée <alex.bennee@linaro.org>
 Message-id: 20180627043328.11531-32-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/translate-sve.c | 23 ++++++++++++++++++
  target/arm/vec_helper.c    | 50 +++++++++++++++++++++++---------------
  target/arm/sve.decode      |  6 +++++
 files changed, 59 insertions(+), 20 deletions(-)
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
+--- a/target/arm/helper.c
-+++ b/target/arm/translate-sve.c
++++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ static bool trans_FCMLA_zpzzz(DisasContext *s,
+@@ -XXX,XX +XXX,XX @@ load_fail:
-     return true;
+     return false;
  }
-+static bool trans_FCMLA_zzxz(DisasContext *s, arg_FCMLA_zzxz *a, uint32_t insn)
++static uint32_t v7m_integrity_sig(CPUARMState *env, uint32_t lr)
 +{
-+    static gen_helper_gvec_3_ptr * const fns[2] = {
++    /*
-+        gen_helper_gvec_fcmlah_idx,
++     * Return the integrity signature value for the callee-saves
-+        gen_helper_gvec_fcmlas_idx,
++     * stack frame section. @lr is the exception return payload/LR value
-+    };
++     * whose FType bit forms bit 0 of the signature if FP is present.
 +     */
 +    uint32_t sig = 0xfefa125a;
 +
-+    tcg_debug_assert(a->esz == 1 || a->esz == 2);
++    if (!arm_feature(env, ARM_FEATURE_VFP) || (lr & R_V7M_EXCRET_FTYPE_MASK)) {
-+    tcg_debug_assert(a->rd == a->ra);
++        sig |= 1;
 +    if (sve_access_check(s)) {
 +        unsigned vsz = vec_full_reg_size(s);
 +        TCGv_ptr status = get_fpstatus_ptr(a->esz == MO_16);
 +        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, a->rd),
 +                           vec_full_reg_offset(s, a->rn),
 +                           vec_full_reg_offset(s, a->rm),
 +                           status, vsz, vsz,
 +                           a->index * 4 + a->rot,
 +                           fns[a->esz - 1]);
 +        tcg_temp_free_ptr(status);
 +    }
-+    return true;
++    return sig;
 +}
 +
- /*
+ static bool v7m_push_callee_stack(ARMCPU *cpu, uint32_t lr, bool dotailchain,
-  *** SVE Floating Point Unary Operations Predicated Group
+                                   bool ignore_faults)
-  */
+ {
-diff --git a/target/arm/vec_helper.c b/target/arm/vec_helper.c
+@@ -XXX,XX +XXX,XX @@ static bool v7m_push_callee_stack(ARMCPU *cpu, uint32_t lr, bool dotailchain,
-index XXXXXXX..XXXXXXX 100644
+     bool stacked_ok;
---- a/target/arm/vec_helper.c
+     uint32_t limit;
-+++ b/target/arm/vec_helper.c
+     bool want_psp;
-@@ -XXX,XX +XXX,XX @@ void HELPER(gvec_fcmlah_idx)(void *vd, void *vn, void *vm,
++    uint32_t sig;
-     uint32_t neg_imag = extract32(desc, SIMD_DATA_SHIFT + 1, 1);
-     intptr_t index = extract32(desc, SIMD_DATA_SHIFT + 2, 2);
+     if (dotailchain) {
-     uint32_t neg_real = flip ^ neg_imag;
+         bool mode = lr & R_V7M_EXCRET_MODE_MASK;
--    uintptr_t i;
+@@ -XXX,XX +XXX,XX @@ static bool v7m_push_callee_stack(ARMCPU *cpu, uint32_t lr, bool dotailchain,
--    float16 e1 = m[H2(2 * index + flip)];
+     /* Write as much of the stack frame as we can. A write failure may
--    float16 e3 = m[H2(2 * index + 1 - flip)];
+      * cause us to pend a derived exception.
-+    intptr_t elements = opr_sz / sizeof(float16);
+      */
-+    intptr_t eltspersegment = 16 / sizeof(float16);
++    sig = v7m_integrity_sig(env, lr);
-+    intptr_t i, j;
+     stacked_ok =
+-        v7m_stack_write(cpu, frameptr, 0xfefa125b, mmu_idx, ignore_faults) &&
-     /* Shift boolean to the sign bit so we can xor to negate.  */
++        v7m_stack_write(cpu, frameptr, sig, mmu_idx, ignore_faults) &&
-     neg_real <<= 15;
+         v7m_stack_write(cpu, frameptr + 0x8, env->regs[4], mmu_idx,
-     neg_imag <<= 15;
+                         ignore_faults) &&
--    e1 ^= neg_real;
+         v7m_stack_write(cpu, frameptr + 0xc, env->regs[5], mmu_idx,
--    e3 ^= neg_imag;
+@@ -XXX,XX +XXX,XX @@ static void do_v7m_exception_exit(ARMCPU *cpu)
+         if (return_to_secure &&
--    for (i = 0; i < opr_sz / 2; i += 2) {
+             ((excret & R_V7M_EXCRET_ES_MASK) == 0 ||
--        float16 e2 = n[H2(i + flip)];
+              (excret & R_V7M_EXCRET_DCRS_MASK) == 0)) {
--        float16 e4 = e2;
+-            uint32_t expected_sig = 0xfefa125b;
-+    for (i = 0; i < elements; i += eltspersegment) {
+             uint32_t actual_sig;
-+        float16 mr = m[H2(i + 2 * index + 0)];
-+        float16 mi = m[H2(i + 2 * index + 1)];
+             pop_ok = v7m_stack_read(cpu, &actual_sig, frameptr, mmu_idx);
-+        float16 e1 = neg_real ^ (flip ? mi : mr);
-+        float16 e3 = neg_imag ^ (flip ? mr : mi);
+-            if (pop_ok && expected_sig != actual_sig) {
++            if (pop_ok && v7m_integrity_sig(env, excret) != actual_sig) {
--        d[H2(i)] = float16_muladd(e2, e1, d[H2(i)], 0, fpst);
+                 /* Take a SecureFault on the current stack */
--        d[H2(i + 1)] = float16_muladd(e4, e3, d[H2(i + 1)], 0, fpst);
+                 env->v7m.sfsr |= R_V7M_SFSR_INVIS_MASK;
-+        for (j = i; j < i + eltspersegment; j += 2) {
+                 armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_SECURE, false);
 +            float16 e2 = n[H2(j + flip)];
 +            float16 e4 = e2;
 +
 +            d[H2(j)] = float16_muladd(e2, e1, d[H2(j)], 0, fpst);
 +            d[H2(j + 1)] = float16_muladd(e4, e3, d[H2(j + 1)], 0, fpst);
 +        }
      }
      clear_tail(d, opr_sz, simd_maxsz(desc));
  }
@@ -XXX,XX +XXX,XX @@ void HELPER(gvec_fcmlas_idx)(void *vd, void *vn, void *vm,
      uint32_t neg_imag = extract32(desc, SIMD_DATA_SHIFT + 1, 1);
      intptr_t index = extract32(desc, SIMD_DATA_SHIFT + 2, 2);
      uint32_t neg_real = flip ^ neg_imag;
 -    uintptr_t i;
 -    float32 e1 = m[H4(2 * index + flip)];
 -    float32 e3 = m[H4(2 * index + 1 - flip)];
 +    intptr_t elements = opr_sz / sizeof(float32);
 +    intptr_t eltspersegment = 16 / sizeof(float32);
 +    intptr_t i, j;
      /* Shift boolean to the sign bit so we can xor to negate.  */
      neg_real <<= 31;
      neg_imag <<= 31;
 -    e1 ^= neg_real;
 -    e3 ^= neg_imag;
 -    for (i = 0; i < opr_sz / 4; i += 2) {
 -        float32 e2 = n[H4(i + flip)];
 -        float32 e4 = e2;
 +    for (i = 0; i < elements; i += eltspersegment) {
 +        float32 mr = m[H4(i + 2 * index + 0)];
 +        float32 mi = m[H4(i + 2 * index + 1)];
 +        float32 e1 = neg_real ^ (flip ? mi : mr);
 +        float32 e3 = neg_imag ^ (flip ? mr : mi);
 -        d[H4(i)] = float32_muladd(e2, e1, d[H4(i)], 0, fpst);
 -        d[H4(i + 1)] = float32_muladd(e4, e3, d[H4(i + 1)], 0, fpst);
 +        for (j = i; j < i + eltspersegment; j += 2) {
 +            float32 e2 = n[H4(j + flip)];
 +            float32 e4 = e2;
 +
 +            d[H4(j)] = float32_muladd(e2, e1, d[H4(j)], 0, fpst);
 +            d[H4(j + 1)] = float32_muladd(e4, e3, d[H4(j + 1)], 0, fpst);
 +        }
      }
      clear_tail(d, opr_sz, simd_maxsz(desc));
  }
 diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve.decode
 +++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@ FCADD           01100100 esz:2 00000 rot:1 100 pg:3 rm:5 rd:5 \
  FCMLA_zpzzz     01100100 esz:2 0 rm:5 0 rot:2 pg:3 rn:5 rd:5 \
                  ra=%reg_movprfx
 +# SVE floating-point complex multiply-add (indexed)
 +FCMLA_zzxz      01100100 10 1 index:2 rm:3 0001 rot:2 rn:5 rd:5 \
 +                ra=%reg_movprfx esz=1
 +FCMLA_zzxz      01100100 11 1 index:1 rm:4 0001 rot:2 rn:5 rd:5 \
 +                ra=%reg_movprfx esz=2
 +
  ### SVE FP Multiply-Add Indexed Group
  # SVE floating-point multiply-add (indexed)
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 14/55] target/arm: Implement SVE Floating Point Accumulating Reduction Group
+[Qemu-devel] [PULL 18/42] target/arm: Handle floating point registers in exception return
-From: Richard Henderson <richard.henderson@linaro.org>
+Handle floating point registers in exception return.
 This corresponds to pseudocode functions ValidateExceptionReturn(),
 ExceptionReturn(), PopStack() and ConsumeExcStackFrame().
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20180627043328.11531-9-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-16-peter.maydell@linaro.org
 ---
- target/arm/helper-sve.h    |  7 +++++
+ target/arm/helper.c | 142 +++++++++++++++++++++++++++++++++++++++++++-
- target/arm/sve_helper.c    | 56 ++++++++++++++++++++++++++++++++++++++
+file changed, 141 insertions(+), 1 deletion(-)
  target/arm/translate-sve.c | 45 ++++++++++++++++++++++++++++++
  target/arm/sve.decode      |  5 ++++
 files changed, 113 insertions(+)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
+diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
+--- a/target/arm/helper.c
-+++ b/target/arm/helper-sve.h
++++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_5(gvec_rsqrts_s, TCG_CALL_NO_RWG,
+@@ -XXX,XX +XXX,XX @@ static void do_v7m_exception_exit(ARMCPU *cpu)
- DEF_HELPER_FLAGS_5(gvec_rsqrts_d, TCG_CALL_NO_RWG,
+     bool rettobase = false;
-                    void, ptr, ptr, ptr, ptr, i32)
+     bool exc_secure = false;
+     bool return_to_secure;
-+DEF_HELPER_FLAGS_5(sve_fadda_h, TCG_CALL_NO_RWG,
++    bool ftype;
-+                   i64, i64, ptr, ptr, ptr, i32)
++    bool restore_s16_s31;
-+DEF_HELPER_FLAGS_5(sve_fadda_s, TCG_CALL_NO_RWG,
-+                   i64, i64, ptr, ptr, ptr, i32)
+     /* If we're not in Handler mode then jumps to magic exception-exit
-+DEF_HELPER_FLAGS_5(sve_fadda_d, TCG_CALL_NO_RWG,
+      * addresses don't have magic behaviour. However for the v8M
-+                   i64, i64, ptr, ptr, ptr, i32)
+@@ -XXX,XX +XXX,XX @@ static void do_v7m_exception_exit(ARMCPU *cpu)
                        excret);
      }
 +    ftype = excret & R_V7M_EXCRET_FTYPE_MASK;
 +
- DEF_HELPER_FLAGS_6(sve_fadd_h, TCG_CALL_NO_RWG,
++    if (!arm_feature(env, ARM_FEATURE_VFP) && !ftype) {
-                    void, ptr, ptr, ptr, ptr, ptr, i32)
++        qemu_log_mask(LOG_GUEST_ERROR, "M profile: zero FTYPE in exception "
- DEF_HELPER_FLAGS_6(sve_fadd_s, TCG_CALL_NO_RWG,
++                      "exit PC value 0x%" PRIx32 " is UNPREDICTABLE "
-diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
++                      "if FPU not present\n",
-index XXXXXXX..XXXXXXX 100644
++                      excret);
---- a/target/arm/sve_helper.c
++        ftype = true;
-+++ b/target/arm/sve_helper.c
++    }
@@ -XXX,XX +XXX,XX @@ uint32_t HELPER(sve_while)(void *vd, uint32_t count, uint32_t pred_desc)
      return predtest_ones(d, oprsz, esz_mask);
  }
 +uint64_t HELPER(sve_fadda_h)(uint64_t nn, void *vm, void *vg,
 +                             void *status, uint32_t desc)
 +{
 +    intptr_t i = 0, opr_sz = simd_oprsz(desc);
 +    float16 result = nn;
 +
-+    do {
+     if (arm_feature(env, ARM_FEATURE_M_SECURITY)) {
-+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));
+         /* EXC_RETURN.ES validation check (R_SMFL). We must do this before
-+        do {
+          * we pick which FAULTMASK to clear.
-+            if (pg & 1) {
+@@ -XXX,XX +XXX,XX @@ static void do_v7m_exception_exit(ARMCPU *cpu)
-+                float16 mm = *(float16 *)(vm + H1_2(i));
+      */
-+                result = float16_add(result, mm, status);
+     write_v7m_control_spsel_for_secstate(env, return_to_sp_process, exc_secure);
 +    /*
 +     * Clear scratch FP values left in caller saved registers; this
 +     * must happen before any kind of tail chaining.
 +     */
 +    if ((env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_CLRONRET_MASK) &&
 +        (env->v7m.control[M_REG_S] & R_V7M_CONTROL_FPCA_MASK)) {
 +        if (env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_LSPACT_MASK) {
 +            env->v7m.sfsr |= R_V7M_SFSR_LSERR_MASK;
 +            armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_SECURE, false);
 +            qemu_log_mask(CPU_LOG_INT, "...taking SecureFault on existing "
 +                          "stackframe: error during lazy state deactivation\n");
 +            v7m_exception_taken(cpu, excret, true, false);
 +            return;
 +        } else {
 +            /* Clear s0..s15 and FPSCR */
 +            int i;
 +
 +            for (i = 0; i < 16; i += 2) {
 +                *aa32_vfp_dreg(env, i / 2) = 0;
 +            }
-+            i += sizeof(float16), pg >>= sizeof(float16);
++            vfp_set_fpscr(env, 0);
 +        } while (i & 15);
 +    } while (i < opr_sz);
 +
 +    return result;
 +}
 +
 +uint64_t HELPER(sve_fadda_s)(uint64_t nn, void *vm, void *vg,
 +                             void *status, uint32_t desc)
 +{
 +    intptr_t i = 0, opr_sz = simd_oprsz(desc);
 +    float32 result = nn;
 +
 +    do {
 +        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));
 +        do {
 +            if (pg & 1) {
 +                float32 mm = *(float32 *)(vm + H1_2(i));
 +                result = float32_add(result, mm, status);
 +            }
 +            i += sizeof(float32), pg >>= sizeof(float32);
 +        } while (i & 15);
 +    } while (i < opr_sz);
 +
 +    return result;
 +}
 +
 +uint64_t HELPER(sve_fadda_d)(uint64_t nn, void *vm, void *vg,
 +                             void *status, uint32_t desc)
 +{
 +    intptr_t i = 0, opr_sz = simd_oprsz(desc) / 8;
 +    uint64_t *m = vm;
 +    uint8_t *pg = vg;
 +
 +    for (i = 0; i < opr_sz; i++) {
 +        if (pg[H1(i)] & 1) {
 +            nn = float64_add(nn, m[i], status);
 +        }
 +    }
 +
-+    return nn;
+     if (sfault) {
-+}
+         env->v7m.sfsr |= R_V7M_SFSR_INVER_MASK;
          armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_SECURE, false);
@@ -XXX,XX +XXX,XX @@ static void do_v7m_exception_exit(ARMCPU *cpu)
              }
          }
 +        if (!ftype) {
 +            /* FP present and we need to handle it */
 +            if (!return_to_secure &&
 +                (env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_LSPACT_MASK)) {
 +                armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_SECURE, false);
 +                env->v7m.sfsr |= R_V7M_SFSR_LSERR_MASK;
 +                qemu_log_mask(CPU_LOG_INT,
 +                              "...taking SecureFault on existing stackframe: "
 +                              "Secure LSPACT set but exception return is "
 +                              "not to secure state\n");
 +                v7m_exception_taken(cpu, excret, true, false);
 +                return;
 +            }
 +
- /* Fully general three-operand expander, controlled by a predicate,
++            restore_s16_s31 = return_to_secure &&
-  * With the extra float_status parameter.
++                (env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_TS_MASK);
   */
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-sve.c
 +++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ DO_ZZI(UMIN, umin)
  #undef DO_ZZI
 +/*
 + *** SVE Floating Point Accumulating Reduction Group
 + */
 +
-+static bool trans_FADDA(DisasContext *s, arg_rprr_esz *a, uint32_t insn)
++            if (env->v7m.fpccr[return_to_secure] & R_V7M_FPCCR_LSPACT_MASK) {
-+{
++                /* State in FPU is still valid, just clear LSPACT */
-+    typedef void fadda_fn(TCGv_i64, TCGv_i64, TCGv_ptr,
++                env->v7m.fpccr[return_to_secure] &= ~R_V7M_FPCCR_LSPACT_MASK;
-+                          TCGv_ptr, TCGv_ptr, TCGv_i32);
++            } else {
-+    static fadda_fn * const fns[3] = {
++                int i;
-+        gen_helper_sve_fadda_h,
++                uint32_t fpscr;
-+        gen_helper_sve_fadda_s,
++                bool cpacr_pass, nsacr_pass;
 +        gen_helper_sve_fadda_d,
 +    };
 +    unsigned vsz = vec_full_reg_size(s);
 +    TCGv_ptr t_rm, t_pg, t_fpst;
 +    TCGv_i64 t_val;
 +    TCGv_i32 t_desc;
 +
-+    if (a->esz == 0) {
++                cpacr_pass = v7m_cpacr_pass(env, return_to_secure,
-+        return false;
++                                            return_to_priv);
 +                nsacr_pass = return_to_secure ||
 +                    extract32(env->v7m.nsacr, 10, 1);
 +
 +                if (!cpacr_pass) {
 +                    armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE,
 +                                            return_to_secure);
 +                    env->v7m.cfsr[return_to_secure] |= R_V7M_CFSR_NOCP_MASK;
 +                    qemu_log_mask(CPU_LOG_INT,
 +                                  "...taking UsageFault on existing "
 +                                  "stackframe: CPACR.CP10 prevents unstacking "
 +                                  "FP regs\n");
 +                    v7m_exception_taken(cpu, excret, true, false);
 +                    return;
 +                } else if (!nsacr_pass) {
 +                    armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE, true);
 +                    env->v7m.cfsr[M_REG_S] |= R_V7M_CFSR_INVPC_MASK;
 +                    qemu_log_mask(CPU_LOG_INT,
 +                                  "...taking Secure UsageFault on existing "
 +                                  "stackframe: NSACR.CP10 prevents unstacking "
 +                                  "FP regs\n");
 +                    v7m_exception_taken(cpu, excret, true, false);
 +                    return;
 +                }
 +
 +                for (i = 0; i < (restore_s16_s31 ? 32 : 16); i += 2) {
 +                    uint32_t slo, shi;
 +                    uint64_t dn;
 +                    uint32_t faddr = frameptr + 0x20 + 4 * i;
 +
 +                    if (i >= 16) {
 +                        faddr += 8; /* Skip the slot for the FPSCR */
 +                    }
 +
 +                    pop_ok = pop_ok &&
 +                        v7m_stack_read(cpu, &slo, faddr, mmu_idx) &&
 +                        v7m_stack_read(cpu, &shi, faddr + 4, mmu_idx);
 +
 +                    if (!pop_ok) {
 +                        break;
 +                    }
 +
 +                    dn = (uint64_t)shi << 32 | slo;
 +                    *aa32_vfp_dreg(env, i / 2) = dn;
 +                }
 +                pop_ok = pop_ok &&
 +                    v7m_stack_read(cpu, &fpscr, frameptr + 0x60, mmu_idx);
 +                if (pop_ok) {
 +                    vfp_set_fpscr(env, fpscr);
 +                }
 +                if (!pop_ok) {
 +                    /*
 +                     * These regs are 0 if security extension present;
 +                     * otherwise merely UNKNOWN. We zero always.
 +                     */
 +                    for (i = 0; i < (restore_s16_s31 ? 32 : 16); i += 2) {
 +                        *aa32_vfp_dreg(env, i / 2) = 0;
 +                    }
 +                    vfp_set_fpscr(env, 0);
 +                }
 +            }
 +        }
 +        env->v7m.control[M_REG_S] = FIELD_DP32(env->v7m.control[M_REG_S],
 +                                               V7M_CONTROL, FPCA, !ftype);
 +
          /* Commit to consuming the stack frame */
          frameptr += 0x20;
 +        if (!ftype) {
 +            frameptr += 0x48;
 +            if (restore_s16_s31) {
 +                frameptr += 0x40;
 +            }
 +        }
          /* Undo stack alignment (the SPREALIGN bit indicates that the original
           * pre-exception SP was not 8-aligned and we added a padding word to
           * align it, so we undo this by ORing in the bit that increases it
@@ -XXX,XX +XXX,XX @@ static void do_v7m_exception_exit(ARMCPU *cpu)
          *frame_sp_p = frameptr;
      }
      /* This xpsr_write() will invalidate frame_sp_p as it may switch stack */
 -    xpsr_write(env, xpsr, ~XPSR_SPREALIGN);
 +    xpsr_write(env, xpsr, ~(XPSR_SPREALIGN | XPSR_SFPA));
 +
 +    if (env->v7m.secure) {
 +        bool sfpa = xpsr & XPSR_SFPA;
 +
 +        env->v7m.control[M_REG_S] = FIELD_DP32(env->v7m.control[M_REG_S],
 +                                               V7M_CONTROL, SFPA, sfpa);
 +    }
-+    if (!sve_access_check(s)) {
-+        return true;
+     /* The restored xPSR exception field will be zero if we're
-+    }
+      * resuming in Thread mode. If that doesn't match what the
 +
 +    t_val = load_esz(cpu_env, vec_reg_offset(s, a->rn, 0, a->esz), a->esz);
 +    t_rm = tcg_temp_new_ptr();
 +    t_pg = tcg_temp_new_ptr();
 +    tcg_gen_addi_ptr(t_rm, cpu_env, vec_full_reg_offset(s, a->rm));
 +    tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, a->pg));
 +    t_fpst = get_fpstatus_ptr(a->esz == MO_16);
 +    t_desc = tcg_const_i32(simd_desc(vsz, vsz, 0));
 +
 +    fns[a->esz - 1](t_val, t_val, t_rm, t_pg, t_fpst, t_desc);
 +
 +    tcg_temp_free_i32(t_desc);
 +    tcg_temp_free_ptr(t_fpst);
 +    tcg_temp_free_ptr(t_pg);
 +    tcg_temp_free_ptr(t_rm);
 +
 +    write_fp_dreg(s, a->rd, t_val);
 +    tcg_temp_free_i64(t_val);
 +    return true;
 +}
 +
  /*
   *** SVE Floating Point Arithmetic - Unpredicated Group
   */
 diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve.decode
 +++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@ UMIN_zzi        00100101 .. 101 011 110 ........ .....          @rdn_i8u
  # SVE integer multiply immediate (unpredicated)
  MUL_zzi         00100101 .. 110 000 110 ........ .....          @rdn_i8s
 +### SVE FP Accumulating Reduction Group
 +
 +# SVE floating-point serial reduction (predicated)
 +FADDA           01100101 .. 011 000 001 ... ..... .....         @rdn_pg_rm
 +
  ### SVE Floating Point Arithmetic - Unpredicated Group
  # SVE floating-point arithmetic (unpredicated)
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 46/55] target/arm: Add ARM_FEATURE_V7VE for v7 Virtualization Extensions
+[Qemu-devel] [PULL 19/42] target/arm: Move NS TBFLAG from bit 19 to bit 6
-From: Aaron Lindsay <alindsay@codeaurora.org>
+Move the NS TBFLAG down from bit 19 to bit 6, which has not
 been used since commit c1e3781090b9d36c60 in 2015, when we
 started passing the entire MMU index in the TB flags rather
 than just a 'privilege level' bit.
-Signed-off-by: Aaron Lindsay <alindsay@codeaurora.org>
+This rearrangement is not strictly necessary, but means that
-Message-id: 1529699547-17044-5-git-send-email-alindsay@codeaurora.org
+we can put M-profile-only bits next to each other rather
 than scattered across the flag word.
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-17-peter.maydell@linaro.org
 ---
- target/arm/cpu.h   |  1 +
+ target/arm/cpu.h | 11 ++++++-----
- target/arm/cpu.c   | 21 ++++++++++++++-------
+file changed, 6 insertions(+), 5 deletions(-)
  target/arm/kvm32.c |  8 ++++----
 files changed, 19 insertions(+), 11 deletions(-)
 diff --git a/target/arm/cpu.h b/target/arm/cpu.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu.h
 +++ b/target/arm/cpu.h
-@@ -XXX,XX +XXX,XX @@ enum arm_features {
+@@ -XXX,XX +XXX,XX @@ FIELD(TBFLAG_ANY, BE_DATA, 23, 1)
-     ARM_FEATURE_OMAPCP, /* OMAP specific CP15 ops handling.  */
+ FIELD(TBFLAG_A32, THUMB, 0, 1)
-     ARM_FEATURE_THUMB2EE,
+ FIELD(TBFLAG_A32, VECLEN, 1, 3)
-     ARM_FEATURE_V7MP,    /* v7 Multiprocessing Extensions */
+ FIELD(TBFLAG_A32, VECSTRIDE, 4, 2)
-+    ARM_FEATURE_V7VE, /* v7 Virtualization Extensions (non-EL2 parts) */
++/*
-     ARM_FEATURE_V4T,
++ * Indicates whether cp register reads and writes by guest code should access
-     ARM_FEATURE_V5,
++ * the secure or nonsecure bank of banked registers; note that this is not
-     ARM_FEATURE_STRONGARM,
++ * the same thing as the current security state of the processor!
-diff --git a/target/arm/cpu.c b/target/arm/cpu.c
++ */
-index XXXXXXX..XXXXXXX 100644
++FIELD(TBFLAG_A32, NS, 6, 1)
---- a/target/arm/cpu.c
+ FIELD(TBFLAG_A32, VFPEN, 7, 1)
-+++ b/target/arm/cpu.c
+ FIELD(TBFLAG_A32, CONDEXEC, 8, 8)
-@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
+ FIELD(TBFLAG_A32, SCTLR_B, 16, 1)
+@@ -XXX,XX +XXX,XX @@ FIELD(TBFLAG_A32, SCTLR_B, 16, 1)
-     /* Some features automatically imply others: */
+  * checks on the other bits at runtime
-     if (arm_feature(env, ARM_FEATURE_V8)) {
+  */
--        set_feature(env, ARM_FEATURE_V7);
+ FIELD(TBFLAG_A32, XSCALE_CPAR, 17, 2)
-+        set_feature(env, ARM_FEATURE_V7VE);
+-/* Indicates whether cp register reads and writes by guest code should access
-+    }
+- * the secure or nonsecure bank of banked registers; note that this is not
-+    if (arm_feature(env, ARM_FEATURE_V7VE)) {
+- * the same thing as the current security state of the processor!
-+        /* v7 Virtualization Extensions. In real hardware this implies
+- */
-+         * EL2 and also the presence of the Security Extensions.
+-FIELD(TBFLAG_A32, NS, 19, 1)
-+         * For QEMU, for backwards-compatibility we implement some
+ /* For M profile only, Handler (ie not Thread) mode */
-+         * CPUs or CPU configs which have no actual EL2 or EL3 but do
+ FIELD(TBFLAG_A32, HANDLER, 21, 1)
-+         * include the various other features that V7VE implies.
+ /* For M profile only, whether we should generate stack-limit checks */
 +         * Presence of EL2 itself is ARM_FEATURE_EL2, and of the
 +         * Security Extensions is ARM_FEATURE_EL3.
 +         */
          set_feature(env, ARM_FEATURE_ARM_DIV);
          set_feature(env, ARM_FEATURE_LPAE);
 +        set_feature(env, ARM_FEATURE_V7);
      }
      if (arm_feature(env, ARM_FEATURE_V7)) {
          set_feature(env, ARM_FEATURE_VAPA);
@@ -XXX,XX +XXX,XX @@ static void cortex_a7_initfn(Object *obj)
      ARMCPU *cpu = ARM_CPU(obj);
      cpu->dtb_compatible = "arm,cortex-a7";
 -    set_feature(&cpu->env, ARM_FEATURE_V7);
 +    set_feature(&cpu->env, ARM_FEATURE_V7VE);
      set_feature(&cpu->env, ARM_FEATURE_VFP4);
      set_feature(&cpu->env, ARM_FEATURE_NEON);
      set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
 -    set_feature(&cpu->env, ARM_FEATURE_ARM_DIV);
      set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
      set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
      set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
 -    set_feature(&cpu->env, ARM_FEATURE_LPAE);
      set_feature(&cpu->env, ARM_FEATURE_EL3);
      cpu->kvm_target = QEMU_KVM_ARM_TARGET_CORTEX_A7;
      cpu->midr = 0x410fc075;
@@ -XXX,XX +XXX,XX @@ static void cortex_a15_initfn(Object *obj)
      ARMCPU *cpu = ARM_CPU(obj);
      cpu->dtb_compatible = "arm,cortex-a15";
 -    set_feature(&cpu->env, ARM_FEATURE_V7);
 +    set_feature(&cpu->env, ARM_FEATURE_V7VE);
      set_feature(&cpu->env, ARM_FEATURE_VFP4);
      set_feature(&cpu->env, ARM_FEATURE_NEON);
      set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
 -    set_feature(&cpu->env, ARM_FEATURE_ARM_DIV);
      set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
      set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
      set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
 -    set_feature(&cpu->env, ARM_FEATURE_LPAE);
      set_feature(&cpu->env, ARM_FEATURE_EL3);
      cpu->kvm_target = QEMU_KVM_ARM_TARGET_CORTEX_A15;
      cpu->midr = 0x412fc0f1;
 diff --git a/target/arm/kvm32.c b/target/arm/kvm32.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/kvm32.c
 +++ b/target/arm/kvm32.c
@@ -XXX,XX +XXX,XX @@ bool kvm_arm_get_host_cpu_features(ARMHostCPUFeatures *ahcf)
      /* Now we've retrieved all the register information we can
       * set the feature bits based on the ID register fields.
       * We can assume any KVM supporting CPU is at least a v7
 -     * with VFPv3, LPAE and the generic timers; this in turn implies
 -     * most of the other feature bits, but a few must be tested.
 +     * with VFPv3, virtualization extensions, and the generic
 +     * timers; this in turn implies most of the other feature
 +     * bits, but a few must be tested.
       */
 -    set_feature(&features, ARM_FEATURE_V7);
 +    set_feature(&features, ARM_FEATURE_V7VE);
      set_feature(&features, ARM_FEATURE_VFP3);
 -    set_feature(&features, ARM_FEATURE_LPAE);
      set_feature(&features, ARM_FEATURE_GENERIC_TIMER);
      switch (extract32(id_isar0, 24, 4)) {
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 41/55] target/arm: Implement ARMv8.2-DotProd
+[Qemu-devel] [PULL 20/42] target/arm: Overlap VECSTRIDE and XSCALE_CPAR TB flags
-From: Richard Henderson <richard.henderson@linaro.org>
+We are close to running out of TB flags for AArch32; we could
 start using the cs_base word, but before we do that we can
 economise on our usage by sharing the same bits for the VFP
 VECSTRIDE field and the XScale XSCALE_CPAR field. This
 works because no XScale CPU ever had VFP.
-We've already added the helpers with an SVE patch, all that remains
-is to wire up the aa64 and aa32 translators.  Enable the feature
-within -cpu max for CONFIG_USER_ONLY.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20180627043328.11531-36-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-18-peter.maydell@linaro.org
 ---
- target/arm/cpu.h           |  1 +
+ target/arm/cpu.h       | 10 ++++++----
- linux-user/elfload.c       |  1 +
+ target/arm/cpu.c       |  7 +++++++
- target/arm/cpu.c           |  1 +
+ target/arm/helper.c    |  6 +++++-
- target/arm/cpu64.c         |  1 +
+ target/arm/translate.c |  9 +++++++--
- target/arm/translate-a64.c | 36 +++++++++++++++++++
+files changed, 25 insertions(+), 7 deletions(-)
  target/arm/translate.c     | 74 +++++++++++++++++++++++++++-----------
 files changed, 93 insertions(+), 21 deletions(-)
 diff --git a/target/arm/cpu.h b/target/arm/cpu.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu.h
 +++ b/target/arm/cpu.h
-@@ -XXX,XX +XXX,XX @@ enum arm_features {
+@@ -XXX,XX +XXX,XX @@ FIELD(TBFLAG_ANY, BE_DATA, 23, 1)
-     ARM_FEATURE_V8_SM4, /* implements SM4 part of v8 Crypto Extensions */
+ FIELD(TBFLAG_A32, THUMB, 0, 1)
-     ARM_FEATURE_V8_ATOMICS, /* ARMv8.1-Atomics feature */
+ FIELD(TBFLAG_A32, VECLEN, 1, 3)
-     ARM_FEATURE_V8_RDM, /* implements v8.1 simd round multiply */
+ FIELD(TBFLAG_A32, VECSTRIDE, 4, 2)
-+    ARM_FEATURE_V8_DOTPROD, /* implements v8.2 simd dot product */
++/*
-     ARM_FEATURE_V8_FP16, /* implements v8.2 half-precision float */
++ * We store the bottom two bits of the CPAR as TB flags and handle
-     ARM_FEATURE_V8_FCMA, /* has complex number part of v8.3 extensions.  */
++ * checks on the other bits at runtime. This shares the same bits as
-     ARM_FEATURE_M_MAIN, /* M profile Main Extension */
++ * VECSTRIDE, which is OK as no XScale CPU has VFP.
-diff --git a/linux-user/elfload.c b/linux-user/elfload.c
++ */
-index XXXXXXX..XXXXXXX 100644
++FIELD(TBFLAG_A32, XSCALE_CPAR, 4, 2)
---- a/linux-user/elfload.c
+ /*
-+++ b/linux-user/elfload.c
+  * Indicates whether cp register reads and writes by guest code should access
-@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
+  * the secure or nonsecure bank of banked registers; note that this is not
-                 ARM_HWCAP_A64_FPHP | ARM_HWCAP_A64_ASIMDHP);
+@@ -XXX,XX +XXX,XX @@ FIELD(TBFLAG_A32, NS, 6, 1)
-     GET_FEATURE(ARM_FEATURE_V8_ATOMICS, ARM_HWCAP_A64_ATOMICS);
+ FIELD(TBFLAG_A32, VFPEN, 7, 1)
-     GET_FEATURE(ARM_FEATURE_V8_RDM, ARM_HWCAP_A64_ASIMDRDM);
+ FIELD(TBFLAG_A32, CONDEXEC, 8, 8)
-+    GET_FEATURE(ARM_FEATURE_V8_DOTPROD, ARM_HWCAP_A64_ASIMDDP);
+ FIELD(TBFLAG_A32, SCTLR_B, 16, 1)
-     GET_FEATURE(ARM_FEATURE_V8_FCMA, ARM_HWCAP_A64_FCMA);
+-/* We store the bottom two bits of the CPAR as TB flags and handle
-     GET_FEATURE(ARM_FEATURE_SVE, ARM_HWCAP_A64_SVE);
+- * checks on the other bits at runtime
- #undef GET_FEATURE
+- */
 -FIELD(TBFLAG_A32, XSCALE_CPAR, 17, 2)
  /* For M profile only, Handler (ie not Thread) mode */
  FIELD(TBFLAG_A32, HANDLER, 21, 1)
  /* For M profile only, whether we should generate stack-limit checks */
 diff --git a/target/arm/cpu.c b/target/arm/cpu.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu.c
 +++ b/target/arm/cpu.c
-@@ -XXX,XX +XXX,XX @@ static void arm_max_initfn(Object *obj)
+@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
-         set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
+         set_feature(env, ARM_FEATURE_THUMB_DSP);
          set_feature(&cpu->env, ARM_FEATURE_CRC);
          set_feature(&cpu->env, ARM_FEATURE_V8_RDM);
 +        set_feature(&cpu->env, ARM_FEATURE_V8_DOTPROD);
          set_feature(&cpu->env, ARM_FEATURE_V8_FCMA);
  #endif
      }
-diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
 +    /*
 +     * We rely on no XScale CPU having VFP so we can use the same bits in the
 +     * TB flags field for VECSTRIDE and XSCALE_CPAR.
 +     */
 +    assert(!(arm_feature(env, ARM_FEATURE_VFP) &&
 +             arm_feature(env, ARM_FEATURE_XSCALE)));
 +
      if (arm_feature(env, ARM_FEATURE_V7) &&
          !arm_feature(env, ARM_FEATURE_M) &&
          !arm_feature(env, ARM_FEATURE_PMSA)) {
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/cpu64.c
+--- a/target/arm/helper.c
-+++ b/target/arm/cpu64.c
++++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
+@@ -XXX,XX +XXX,XX @@ void cpu_get_tb_cpu_state(CPUARMState *env, target_ulong *pc,
-         set_feature(&cpu->env, ARM_FEATURE_CRC);
+             || arm_el_is_aa64(env, 1) || arm_feature(env, ARM_FEATURE_M)) {
-         set_feature(&cpu->env, ARM_FEATURE_V8_ATOMICS);
+             flags = FIELD_DP32(flags, TBFLAG_A32, VFPEN, 1);
          set_feature(&cpu->env, ARM_FEATURE_V8_RDM);
 +        set_feature(&cpu->env, ARM_FEATURE_V8_DOTPROD);
          set_feature(&cpu->env, ARM_FEATURE_V8_FP16);
          set_feature(&cpu->env, ARM_FEATURE_V8_FCMA);
          set_feature(&cpu->env, ARM_FEATURE_SVE);
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-a64.c
 +++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void gen_gvec_op3(DisasContext *s, bool is_q, int rd,
                     vec_full_reg_size(s), gvec_op);
  }
 +/* Expand a 3-operand operation using an out-of-line helper.  */
 +static void gen_gvec_op3_ool(DisasContext *s, bool is_q, int rd,
 +                             int rn, int rm, int data, gen_helper_gvec_3 *fn)
 +{
 +    tcg_gen_gvec_3_ool(vec_full_reg_offset(s, rd),
 +                       vec_full_reg_offset(s, rn),
 +                       vec_full_reg_offset(s, rm),
 +                       is_q ? 16 : 8, vec_full_reg_size(s), data, fn);
 +}
 +
  /* Expand a 3-operand + env pointer operation using
   * an out-of-line helper.
   */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
          }
-         feature = ARM_FEATURE_V8_RDM;
+-        flags = FIELD_DP32(flags, TBFLAG_A32, XSCALE_CPAR, env->cp15.c15_cpar);
-         break;
++        /* Note that XSCALE_CPAR shares bits with VECSTRIDE */
-+    case 0x02: /* SDOT (vector) */
++        if (arm_feature(env, ARM_FEATURE_XSCALE)) {
-+    case 0x12: /* UDOT (vector) */
++            flags = FIELD_DP32(flags, TBFLAG_A32,
-+        if (size != MO_32) {
++                               XSCALE_CPAR, env->cp15.c15_cpar);
 +            unallocated_encoding(s);
 +            return;
 +        }
-+        feature = ARM_FEATURE_V8_DOTPROD;
-+        break;
-     case 0x8: /* FCMLA, #0 */
-     case 0x9: /* FCMLA, #90 */
-     case 0xa: /* FCMLA, #180 */
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
-         }
-         return;
-+    case 0x2: /* SDOT / UDOT */
-+        gen_gvec_op3_ool(s, is_q, rd, rn, rm, 0,
-+                         u ? gen_helper_gvec_udot_b : gen_helper_gvec_sdot_b);
-+        return;
-+
-     case 0x8: /* FCMLA, #0 */
-     case 0x9: /* FCMLA, #90 */
-     case 0xa: /* FCMLA, #180 */
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
-             return;
-         }
-         break;
-+    case 0x0e: /* SDOT */
-+    case 0x1e: /* UDOT */
-+        if (size != MO_32 || !arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
-+            unallocated_encoding(s);
-+            return;
-+        }
-+        break;
-     case 0x11: /* FCMLA #0 */
-     case 0x13: /* FCMLA #90 */
-     case 0x15: /* FCMLA #180 */
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
      }
-     switch (16 * u + opcode) {
+     flags = FIELD_DP32(flags, TBFLAG_ANY, MMUIDX, arm_to_core_mmu_idx(mmu_idx));
 +    case 0x0e: /* SDOT */
 +    case 0x1e: /* UDOT */
 +        gen_gvec_op3_ool(s, is_q, rd, rn, rm, index,
 +                         u ? gen_helper_gvec_udot_idx_b
 +                         : gen_helper_gvec_sdot_idx_b);
 +        return;
      case 0x11: /* FCMLA #0 */
      case 0x13: /* FCMLA #90 */
      case 0x15: /* FCMLA #180 */
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static void arm_tr_init_disas_context(DisasContextBase *dcbase, CPUState *cs)
-  */
+     dc->fp_excp_el = FIELD_EX32(tb_flags, TBFLAG_ANY, FPEXC_EL);
- static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
+     dc->vfp_enabled = FIELD_EX32(tb_flags, TBFLAG_A32, VFPEN);
- {
+     dc->vec_len = FIELD_EX32(tb_flags, TBFLAG_A32, VECLEN);
--    gen_helper_gvec_3_ptr *fn_gvec_ptr;
+-    dc->vec_stride = FIELD_EX32(tb_flags, TBFLAG_A32, VECSTRIDE);
--    int rd, rn, rm, rot, size, opr_sz;
+-    dc->c15_cpar = FIELD_EX32(tb_flags, TBFLAG_A32, XSCALE_CPAR);
--    TCGv_ptr fpst;
++    if (arm_feature(env, ARM_FEATURE_XSCALE)) {
-+    gen_helper_gvec_3 *fn_gvec = NULL;
++        dc->c15_cpar = FIELD_EX32(tb_flags, TBFLAG_A32, XSCALE_CPAR);
-+    gen_helper_gvec_3_ptr *fn_gvec_ptr = NULL;
++        dc->vec_stride = 0;
 +    int rd, rn, rm, opr_sz;
 +    int data = 0;
      bool q;
      q = extract32(insn, 6, 1);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
      if ((insn & 0xfe200f10) == 0xfc200800) {
          /* VCMLA -- 1111 110R R.1S .... .... 1000 ...0 .... */
 -        size = extract32(insn, 20, 1);
 -        rot = extract32(insn, 23, 2);
 +        int size = extract32(insn, 20, 1);
 +        data = extract32(insn, 23, 2); /* rot */
          if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)
              || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
              return 1;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
          fn_gvec_ptr = size ? gen_helper_gvec_fcmlas : gen_helper_gvec_fcmlah;
      } else if ((insn & 0xfea00f10) == 0xfc800800) {
          /* VCADD -- 1111 110R 1.0S .... .... 1000 ...0 .... */
 -        size = extract32(insn, 20, 1);
 -        rot = extract32(insn, 24, 1);
 +        int size = extract32(insn, 20, 1);
 +        data = extract32(insn, 24, 1); /* rot */
          if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)
              || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
              return 1;
          }
          fn_gvec_ptr = size ? gen_helper_gvec_fcadds : gen_helper_gvec_fcaddh;
 +    } else if ((insn & 0xfeb00f00) == 0xfc200d00) {
 +        /* V[US]DOT -- 1111 1100 0.10 .... .... 1101 .Q.U .... */
 +        bool u = extract32(insn, 4, 1);
 +        if (!arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
 +            return 1;
 +        }
 +        fn_gvec = u ? gen_helper_gvec_udot_b : gen_helper_gvec_sdot_b;
      } else {
          return 1;
      }
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
      }
      opr_sz = (1 + q) * 8;
 -    fpst = get_fpstatus_ptr(1);
 -    tcg_gen_gvec_3_ptr(vfp_reg_offset(1, rd),
 -                       vfp_reg_offset(1, rn),
 -                       vfp_reg_offset(1, rm), fpst,
 -                       opr_sz, opr_sz, rot, fn_gvec_ptr);
 -    tcg_temp_free_ptr(fpst);
 +    if (fn_gvec_ptr) {
 +        TCGv_ptr fpst = get_fpstatus_ptr(1);
 +        tcg_gen_gvec_3_ptr(vfp_reg_offset(1, rd),
 +                           vfp_reg_offset(1, rn),
 +                           vfp_reg_offset(1, rm), fpst,
 +                           opr_sz, opr_sz, data, fn_gvec_ptr);
 +        tcg_temp_free_ptr(fpst);
 +    } else {
-+        tcg_gen_gvec_3_ool(vfp_reg_offset(1, rd),
++        dc->vec_stride = FIELD_EX32(tb_flags, TBFLAG_A32, VECSTRIDE);
-+                           vfp_reg_offset(1, rn),
++        dc->c15_cpar = 0;
 +                           vfp_reg_offset(1, rm),
 +                           opr_sz, opr_sz, data, fn_gvec);
 +    }
-     return 0;
+     dc->v7m_handler_mode = FIELD_EX32(tb_flags, TBFLAG_A32, HANDLER);
- }
+     dc->v8m_secure = arm_feature(env, ARM_FEATURE_M_SECURITY) &&
+         regime_is_secure(env, dc->mmu_idx);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
  static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
  {
 -    gen_helper_gvec_3_ptr *fn_gvec_ptr;
 +    gen_helper_gvec_3 *fn_gvec = NULL;
 +    gen_helper_gvec_3_ptr *fn_gvec_ptr = NULL;
      int rd, rn, rm, opr_sz, data;
 -    TCGv_ptr fpst;
      bool q;
      q = extract32(insn, 6, 1);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
          data = (index << 2) | rot;
          fn_gvec_ptr = (size ? gen_helper_gvec_fcmlas_idx
                         : gen_helper_gvec_fcmlah_idx);
 +    } else if ((insn & 0xffb00f00) == 0xfe200d00) {
 +        /* V[US]DOT -- 1111 1110 0.10 .... .... 1101 .Q.U .... */
 +        int u = extract32(insn, 4, 1);
 +        if (!arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
 +            return 1;
 +        }
 +        fn_gvec = u ? gen_helper_gvec_udot_idx_b : gen_helper_gvec_sdot_idx_b;
 +        /* rm is just Vm, and index is M.  */
 +        data = extract32(insn, 5, 1); /* index */
 +        rm = extract32(insn, 0, 4);
      } else {
          return 1;
      }
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
      }
      opr_sz = (1 + q) * 8;
 -    fpst = get_fpstatus_ptr(1);
 -    tcg_gen_gvec_3_ptr(vfp_reg_offset(1, rd),
 -                       vfp_reg_offset(1, rn),
 -                       vfp_reg_offset(1, rm), fpst,
 -                       opr_sz, opr_sz, data, fn_gvec_ptr);
 -    tcg_temp_free_ptr(fpst);
 +    if (fn_gvec_ptr) {
 +        TCGv_ptr fpst = get_fpstatus_ptr(1);
 +        tcg_gen_gvec_3_ptr(vfp_reg_offset(1, rd),
 +                           vfp_reg_offset(1, rn),
 +                           vfp_reg_offset(1, rm), fpst,
 +                           opr_sz, opr_sz, data, fn_gvec_ptr);
 +        tcg_temp_free_ptr(fpst);
 +    } else {
 +        tcg_gen_gvec_3_ool(vfp_reg_offset(1, rd),
 +                           vfp_reg_offset(1, rn),
 +                           vfp_reg_offset(1, rm),
 +                           opr_sz, opr_sz, data, fn_gvec);
 +    }
      return 0;
  }
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 19/55] target/arm: Implement SVE gather loads
+[Qemu-devel] [PULL 21/42] target/arm: Set FPCCR.S when executing M-profile floating point insns
-From: Richard Henderson <richard.henderson@linaro.org>
+The M-profile FPCCR.S bit indicates the security status of
 the floating point context. In the pseudocode ExecuteFPCheck()
 function it is unconditionally set to match the current
 security state whenever a floating point instruction is
 executed.
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Implement this by adding a new TB flag which tracks whether
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+FPCCR.S is different from the current security state, so
-Reviewed-by: Alex Bennée <alex.bennee@linaro.org>
+that we only need to emit the code to update it in the
-Message-id: 20180627043328.11531-14-richard.henderson@linaro.org
+less-common case when it is not already set correctly.
 Note that we will add the handling for the other work done
 by ExecuteFPCheck() in later commits.
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-19-peter.maydell@linaro.org
 ---
- target/arm/helper-sve.h    |  67 +++++++++++++++++++++++++
+ target/arm/cpu.h       |  2 ++
- target/arm/sve_helper.c    |  77 ++++++++++++++++++++++++++++
+ target/arm/translate.h |  1 +
- target/arm/translate-sve.c | 100 +++++++++++++++++++++++++++++++++++++
+ target/arm/helper.c    |  5 +++++
- target/arm/sve.decode      |  57 +++++++++++++++++++++
+ target/arm/translate.c | 20 ++++++++++++++++++++
-files changed, 301 insertions(+)
+files changed, 28 insertions(+)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
+diff --git a/target/arm/cpu.h b/target/arm/cpu.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
+--- a/target/arm/cpu.h
-+++ b/target/arm/helper-sve.h
++++ b/target/arm/cpu.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_4(sve_st1hd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+@@ -XXX,XX +XXX,XX @@ FIELD(TBFLAG_A32, NS, 6, 1)
+ FIELD(TBFLAG_A32, VFPEN, 7, 1)
- DEF_HELPER_FLAGS_4(sve_st1sd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+ FIELD(TBFLAG_A32, CONDEXEC, 8, 8)
+ FIELD(TBFLAG_A32, SCTLR_B, 16, 1)
-+DEF_HELPER_FLAGS_6(sve_ldbsu_zsu, TCG_CALL_NO_WG,
++/* For M profile only, set if FPCCR.S does not match current security state */
-+                   void, env, ptr, ptr, ptr, tl, i32)
++FIELD(TBFLAG_A32, FPCCR_S_WRONG, 20, 1)
-+DEF_HELPER_FLAGS_6(sve_ldhsu_zsu, TCG_CALL_NO_WG,
+ /* For M profile only, Handler (ie not Thread) mode */
-+                   void, env, ptr, ptr, ptr, tl, i32)
+ FIELD(TBFLAG_A32, HANDLER, 21, 1)
-+DEF_HELPER_FLAGS_6(sve_ldssu_zsu, TCG_CALL_NO_WG,
+ /* For M profile only, whether we should generate stack-limit checks */
-+                   void, env, ptr, ptr, ptr, tl, i32)
+diff --git a/target/arm/translate.h b/target/arm/translate.h
 +DEF_HELPER_FLAGS_6(sve_ldbss_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhss_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_ldbsu_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhsu_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldssu_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldbss_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhss_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_ldbdu_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhdu_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsdu_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldddu_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldbds_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhds_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsds_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_ldbdu_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhdu_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsdu_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldddu_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldbds_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhds_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsds_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_ldbdu_zd, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhdu_zd, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsdu_zd, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldddu_zd, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldbds_zd, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldhds_zd, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldsds_zd, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
  DEF_HELPER_FLAGS_6(sve_stbs_zsu, TCG_CALL_NO_WG,
                     void, env, ptr, ptr, ptr, tl, i32)
  DEF_HELPER_FLAGS_6(sve_sths_zsu, TCG_CALL_NO_WG,
 diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve_helper.c
+--- a/target/arm/translate.h
-+++ b/target/arm/sve_helper.c
++++ b/target/arm/translate.h
-@@ -XXX,XX +XXX,XX @@ void HELPER(sve_st4dd_r)(CPUARMState *env, void *vg,
+@@ -XXX,XX +XXX,XX @@ typedef struct DisasContext {
      bool v7m_handler_mode;
      bool v8m_secure; /* true if v8M and we're in Secure mode */
      bool v8m_stackcheck; /* true if we need to perform v8M stack limit checks */
 +    bool v8m_fpccr_s_wrong; /* true if v8M FPCCR.S != v8m_secure */
      /* Immediate value in AArch32 SVC insn; must be set if is_jmp == DISAS_SWI
       * so that top level loop can generate correct syndrome information.
       */
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void cpu_get_tb_cpu_state(CPUARMState *env, target_ulong *pc,
          flags = FIELD_DP32(flags, TBFLAG_A32, STACKCHECK, 1);
      }
- }
++    if (arm_feature(env, ARM_FEATURE_M_SECURITY) &&
-+/* Loads with a vector index.  */
++        FIELD_EX32(env->v7m.fpccr[M_REG_S], V7M_FPCCR, S) != env->v7m.secure) {
-+
++        flags = FIELD_DP32(flags, TBFLAG_A32, FPCCR_S_WRONG, 1);
 +#define DO_LD1_ZPZ_S(NAME, TYPEI, TYPEM, FN)                            \
 +void HELPER(NAME)(CPUARMState *env, void *vd, void *vg, void *vm,       \
 +                  target_ulong base, uint32_t desc)                     \
 +{                                                                       \
 +    intptr_t i, oprsz = simd_oprsz(desc);                               \
 +    unsigned scale = simd_data(desc);                                   \
 +    uintptr_t ra = GETPC();                                             \
 +    for (i = 0; i < oprsz; i++) {                                       \
 +        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));                 \
 +        do {                                                            \
 +            TYPEM m = 0;                                                \
 +            if (pg & 1) {                                               \
 +                target_ulong off = *(TYPEI *)(vm + H1_4(i));            \
 +                m = FN(env, base + (off << scale), ra);                 \
 +            }                                                           \
 +            *(uint32_t *)(vd + H1_4(i)) = m;                            \
 +            i += 4, pg >>= 4;                                           \
 +        } while (i & 15);                                               \
 +    }                                                                   \
 +}
 +
 +#define DO_LD1_ZPZ_D(NAME, TYPEI, TYPEM, FN)                            \
 +void HELPER(NAME)(CPUARMState *env, void *vd, void *vg, void *vm,       \
 +                  target_ulong base, uint32_t desc)                     \
 +{                                                                       \
 +    intptr_t i, oprsz = simd_oprsz(desc) / 8;                           \
 +    unsigned scale = simd_data(desc);                                   \
 +    uintptr_t ra = GETPC();                                             \
 +    uint64_t *d = vd, *m = vm; uint8_t *pg = vg;                        \
 +    for (i = 0; i < oprsz; i++) {                                       \
 +        TYPEM mm = 0;                                                   \
 +        if (pg[H1(i)] & 1) {                                            \
 +            target_ulong off = (TYPEI)m[i];                             \
 +            mm = FN(env, base + (off << scale), ra);                    \
 +        }                                                               \
 +        d[i] = mm;                                                      \
 +    }                                                                   \
 +}
 +
 +DO_LD1_ZPZ_S(sve_ldbsu_zsu, uint32_t, uint8_t,  cpu_ldub_data_ra)
 +DO_LD1_ZPZ_S(sve_ldhsu_zsu, uint32_t, uint16_t, cpu_lduw_data_ra)
 +DO_LD1_ZPZ_S(sve_ldssu_zsu, uint32_t, uint32_t, cpu_ldl_data_ra)
 +DO_LD1_ZPZ_S(sve_ldbss_zsu, uint32_t, int8_t,   cpu_ldub_data_ra)
 +DO_LD1_ZPZ_S(sve_ldhss_zsu, uint32_t, int16_t,  cpu_lduw_data_ra)
 +
 +DO_LD1_ZPZ_S(sve_ldbsu_zss, int32_t, uint8_t,  cpu_ldub_data_ra)
 +DO_LD1_ZPZ_S(sve_ldhsu_zss, int32_t, uint16_t, cpu_lduw_data_ra)
 +DO_LD1_ZPZ_S(sve_ldssu_zss, int32_t, uint32_t, cpu_ldl_data_ra)
 +DO_LD1_ZPZ_S(sve_ldbss_zss, int32_t, int8_t,   cpu_ldub_data_ra)
 +DO_LD1_ZPZ_S(sve_ldhss_zss, int32_t, int16_t,  cpu_lduw_data_ra)
 +
 +DO_LD1_ZPZ_D(sve_ldbdu_zsu, uint32_t, uint8_t,  cpu_ldub_data_ra)
 +DO_LD1_ZPZ_D(sve_ldhdu_zsu, uint32_t, uint16_t, cpu_lduw_data_ra)
 +DO_LD1_ZPZ_D(sve_ldsdu_zsu, uint32_t, uint32_t, cpu_ldl_data_ra)
 +DO_LD1_ZPZ_D(sve_ldddu_zsu, uint32_t, uint64_t, cpu_ldq_data_ra)
 +DO_LD1_ZPZ_D(sve_ldbds_zsu, uint32_t, int8_t,   cpu_ldub_data_ra)
 +DO_LD1_ZPZ_D(sve_ldhds_zsu, uint32_t, int16_t,  cpu_lduw_data_ra)
 +DO_LD1_ZPZ_D(sve_ldsds_zsu, uint32_t, int32_t,  cpu_ldl_data_ra)
 +
 +DO_LD1_ZPZ_D(sve_ldbdu_zss, int32_t, uint8_t,  cpu_ldub_data_ra)
 +DO_LD1_ZPZ_D(sve_ldhdu_zss, int32_t, uint16_t, cpu_lduw_data_ra)
 +DO_LD1_ZPZ_D(sve_ldsdu_zss, int32_t, uint32_t, cpu_ldl_data_ra)
 +DO_LD1_ZPZ_D(sve_ldddu_zss, int32_t, uint64_t, cpu_ldq_data_ra)
 +DO_LD1_ZPZ_D(sve_ldbds_zss, int32_t, int8_t,   cpu_ldub_data_ra)
 +DO_LD1_ZPZ_D(sve_ldhds_zss, int32_t, int16_t,  cpu_lduw_data_ra)
 +DO_LD1_ZPZ_D(sve_ldsds_zss, int32_t, int32_t,  cpu_ldl_data_ra)
 +
 +DO_LD1_ZPZ_D(sve_ldbdu_zd, uint64_t, uint8_t,  cpu_ldub_data_ra)
 +DO_LD1_ZPZ_D(sve_ldhdu_zd, uint64_t, uint16_t, cpu_lduw_data_ra)
 +DO_LD1_ZPZ_D(sve_ldsdu_zd, uint64_t, uint32_t, cpu_ldl_data_ra)
 +DO_LD1_ZPZ_D(sve_ldddu_zd, uint64_t, uint64_t, cpu_ldq_data_ra)
 +DO_LD1_ZPZ_D(sve_ldbds_zd, uint64_t, int8_t,   cpu_ldub_data_ra)
 +DO_LD1_ZPZ_D(sve_ldhds_zd, uint64_t, int16_t,  cpu_lduw_data_ra)
 +DO_LD1_ZPZ_D(sve_ldsds_zd, uint64_t, int32_t,  cpu_ldl_data_ra)
 +
  /* Stores with a vector index.  */
  #define DO_ST1_ZPZ_S(NAME, TYPEI, FN)                                   \
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-sve.c
 +++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpz(DisasContext *s, int zt, int pg, int zm, int scale,
      tcg_temp_free_i32(desc);
  }
 +/* Indexed by [ff][xs][u][msz].  */
 +static gen_helper_gvec_mem_scatter * const gather_load_fn32[2][2][2][3] = {
 +    { { { gen_helper_sve_ldbss_zsu,
 +          gen_helper_sve_ldhss_zsu,
 +          NULL, },
 +        { gen_helper_sve_ldbsu_zsu,
 +          gen_helper_sve_ldhsu_zsu,
 +          gen_helper_sve_ldssu_zsu, } },
 +      { { gen_helper_sve_ldbss_zss,
 +          gen_helper_sve_ldhss_zss,
 +          NULL, },
 +        { gen_helper_sve_ldbsu_zss,
 +          gen_helper_sve_ldhsu_zss,
 +          gen_helper_sve_ldssu_zss, } } },
 +    /* TODO fill in first-fault handlers */
 +};
 +
 +/* Note that we overload xs=2 to indicate 64-bit offset.  */
 +static gen_helper_gvec_mem_scatter * const gather_load_fn64[2][3][2][4] = {
 +    { { { gen_helper_sve_ldbds_zsu,
 +          gen_helper_sve_ldhds_zsu,
 +          gen_helper_sve_ldsds_zsu,
 +          NULL, },
 +        { gen_helper_sve_ldbdu_zsu,
 +          gen_helper_sve_ldhdu_zsu,
 +          gen_helper_sve_ldsdu_zsu,
 +          gen_helper_sve_ldddu_zsu, } },
 +      { { gen_helper_sve_ldbds_zss,
 +          gen_helper_sve_ldhds_zss,
 +          gen_helper_sve_ldsds_zss,
 +          NULL, },
 +        { gen_helper_sve_ldbdu_zss,
 +          gen_helper_sve_ldhdu_zss,
 +          gen_helper_sve_ldsdu_zss,
 +          gen_helper_sve_ldddu_zss, } },
 +      { { gen_helper_sve_ldbds_zd,
 +          gen_helper_sve_ldhds_zd,
 +          gen_helper_sve_ldsds_zd,
 +          NULL, },
 +        { gen_helper_sve_ldbdu_zd,
 +          gen_helper_sve_ldhdu_zd,
 +          gen_helper_sve_ldsdu_zd,
 +          gen_helper_sve_ldddu_zd, } } },
 +    /* TODO fill in first-fault handlers */
 +};
 +
 +static bool trans_LD1_zprz(DisasContext *s, arg_LD1_zprz *a, uint32_t insn)
 +{
 +    gen_helper_gvec_mem_scatter *fn = NULL;
 +
 +    if (!sve_access_check(s)) {
 +        return true;
 +    }
 +
-+    switch (a->esz) {
+     *pflags = flags;
-+    case MO_32:
+     *cs_base = 0;
-+        fn = gather_load_fn32[a->ff][a->xs][a->u][a->msz];
+ }
-+        break;
+diff --git a/target/arm/translate.c b/target/arm/translate.c
-+    case MO_64:
+index XXXXXXX..XXXXXXX 100644
-+        fn = gather_load_fn64[a->ff][a->xs][a->u][a->msz];
+--- a/target/arm/translate.c
-+        break;
++++ b/target/arm/translate.c
-+    }
+@@ -XXX,XX +XXX,XX @@ static int disas_vfp_insn(DisasContext *s, uint32_t insn)
-+    assert(fn != NULL);
+         }
      }
 +    if (arm_dc_feature(s, ARM_FEATURE_M)) {
 +        /* Handle M-profile lazy FP state mechanics */
 +
-+    do_mem_zpz(s, a->rd, a->pg, a->rm, a->scale * a->msz,
++        /* Update ownership of FP context: set FPCCR.S to match current state */
-+               cpu_reg_sp(s, a->rn), fn);
++        if (s->v8m_fpccr_s_wrong) {
-+    return true;
++            TCGv_i32 tmp;
 +}
 +
-+static bool trans_LD1_zpiz(DisasContext *s, arg_LD1_zpiz *a, uint32_t insn)
++            tmp = load_cpu_field(v7m.fpccr[M_REG_S]);
-+{
++            if (s->v8m_secure) {
-+    gen_helper_gvec_mem_scatter *fn = NULL;
++                tcg_gen_ori_i32(tmp, tmp, R_V7M_FPCCR_S_MASK);
-+    TCGv_i64 imm;
++            } else {
-+
++                tcg_gen_andi_i32(tmp, tmp, ~R_V7M_FPCCR_S_MASK);
-+    if (a->esz < a->msz || (a->esz == a->msz && !a->u)) {
++            }
-+        return false;
++            store_cpu_field(tmp, v7m.fpccr[M_REG_S]);
-+    }
++            /* Don't need to do this for any further FP insns in this TB */
-+    if (!sve_access_check(s)) {
++            s->v8m_fpccr_s_wrong = false;
-+        return true;
++        }
 +    }
 +
-+    switch (a->esz) {
+     if (extract32(insn, 28, 4) == 0xf) {
-+    case MO_32:
+         /*
-+        fn = gather_load_fn32[a->ff][0][a->u][a->msz];
+          * Encodings with T=1 (Thumb) or unconditional (ARM):
-+        break;
+@@ -XXX,XX +XXX,XX @@ static void arm_tr_init_disas_context(DisasContextBase *dcbase, CPUState *cs)
-+    case MO_64:
+     dc->v8m_secure = arm_feature(env, ARM_FEATURE_M_SECURITY) &&
-+        fn = gather_load_fn64[a->ff][2][a->u][a->msz];
+         regime_is_secure(env, dc->mmu_idx);
-+        break;
+     dc->v8m_stackcheck = FIELD_EX32(tb_flags, TBFLAG_A32, STACKCHECK);
-+    }
++    dc->v8m_fpccr_s_wrong = FIELD_EX32(tb_flags, TBFLAG_A32, FPCCR_S_WRONG);
-+    assert(fn != NULL);
+     dc->cp_regs = cpu->cp_regs;
-+
+     dc->features = env->features;
 +    /* Treat LD1_zpiz (zn[x] + imm) the same way as LD1_zprz (rn + zm[x])
 +     * by loading the immediate into the scalar parameter.
 +     */
 +    imm = tcg_const_i64(a->imm << a->msz);
 +    do_mem_zpz(s, a->rd, a->pg, a->rn, 0, imm, fn);
 +    tcg_temp_free_i64(imm);
 +    return true;
 +}
 +
  static bool trans_ST1_zprz(DisasContext *s, arg_ST1_zprz *a, uint32_t insn)
  {
      /* Indexed by [xs][msz].  */
 diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve.decode
 +++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@
  &rpri_load      rd pg rn imm dtype nreg
  &rprr_store     rd pg rn rm msz esz nreg
  &rpri_store     rd pg rn imm msz esz nreg
 +&rprr_gather_load       rd pg rn rm esz msz u ff xs scale
 +&rpri_gather_load       rd pg rn imm esz msz u ff
  &rprr_scatter_store     rd pg rn rm esz msz xs scale
  ###########################################################################
@@ -XXX,XX +XXX,XX @@
  @rpri_load_msz  ....... .... . imm:s4 ... pg:3 rn:5 rd:5 \
                  &rpri_load dtype=%msz_dtype
 +# Gather Loads.
 +@rprr_g_load_u        ....... .. .    . rm:5 . u:1 ff:1 pg:3 rn:5 rd:5 \
 +                      &rprr_gather_load xs=2
 +@rprr_g_load_xs_u     ....... .. xs:1 . rm:5 . u:1 ff:1 pg:3 rn:5 rd:5 \
 +                      &rprr_gather_load
 +@rprr_g_load_xs_u_sc  ....... .. xs:1 scale:1 rm:5 . u:1 ff:1 pg:3 rn:5 rd:5 \
 +                      &rprr_gather_load
 +@rprr_g_load_xs_sc    ....... .. xs:1 scale:1 rm:5 . . ff:1 pg:3 rn:5 rd:5 \
 +                      &rprr_gather_load
 +@rprr_g_load_u_sc     ....... .. .    scale:1 rm:5 . u:1 ff:1 pg:3 rn:5 rd:5 \
 +                      &rprr_gather_load xs=2
 +@rprr_g_load_sc       ....... .. .    scale:1 rm:5 . . ff:1 pg:3 rn:5 rd:5 \
 +                      &rprr_gather_load xs=2
 +@rpri_g_load          ....... msz:2 .. imm:5 . u:1 ff:1 pg:3 rn:5 rd:5 \
 +                      &rpri_gather_load
 +
  # Stores; user must fill in ESZ, MSZ, NREG as needed.
  @rprr_store         ....... ..    ..     rm:5 ... pg:3 rn:5 rd:5    &rprr_store
  @rpri_store_msz     ....... msz:2 .. . imm:s4 ... pg:3 rn:5 rd:5    &rpri_store
@@ -XXX,XX +XXX,XX @@ LDR_zri         10000101 10 ...... 010 ... ..... .....          @rd_rn_i9
  LD1R_zpri       1000010 .. 1 imm:6 1.. pg:3 rn:5 rd:5 \
                  &rpri_load dtype=%dtype_23_13 nreg=0
 +# SVE 32-bit gather load (scalar plus 32-bit unscaled offsets)
 +# SVE 32-bit gather load (scalar plus 32-bit scaled offsets)
 +LD1_zprz        1000010 00 .0 ..... 0.. ... ..... ..... \
 +                @rprr_g_load_xs_u esz=2 msz=0 scale=0
 +LD1_zprz        1000010 01 .. ..... 0.. ... ..... ..... \
 +                @rprr_g_load_xs_u_sc esz=2 msz=1
 +LD1_zprz        1000010 10 .. ..... 01. ... ..... ..... \
 +                @rprr_g_load_xs_sc esz=2 msz=2 u=1
 +
 +# SVE 32-bit gather load (vector plus immediate)
 +LD1_zpiz        1000010 .. 01 ..... 1.. ... ..... ..... \
 +                @rpri_g_load esz=2
 +
  ### SVE Memory Contiguous Load Group
  # SVE contiguous load (scalar plus scalar)
@@ -XXX,XX +XXX,XX @@ PRF_rr          1000010 -- 00 rm:5 110 --- ----- 0 ----
  ### SVE Memory 64-bit Gather Group
 +# SVE 64-bit gather load (scalar plus 32-bit unpacked unscaled offsets)
 +# SVE 64-bit gather load (scalar plus 32-bit unpacked scaled offsets)
 +LD1_zprz        1100010 00 .0 ..... 0.. ... ..... ..... \
 +                @rprr_g_load_xs_u esz=3 msz=0 scale=0
 +LD1_zprz        1100010 01 .. ..... 0.. ... ..... ..... \
 +                @rprr_g_load_xs_u_sc esz=3 msz=1
 +LD1_zprz        1100010 10 .. ..... 0.. ... ..... ..... \
 +                @rprr_g_load_xs_u_sc esz=3 msz=2
 +LD1_zprz        1100010 11 .. ..... 01. ... ..... ..... \
 +                @rprr_g_load_xs_sc esz=3 msz=3 u=1
 +
 +# SVE 64-bit gather load (scalar plus 64-bit unscaled offsets)
 +# SVE 64-bit gather load (scalar plus 64-bit scaled offsets)
 +LD1_zprz        1100010 00 10 ..... 1.. ... ..... ..... \
 +                @rprr_g_load_u esz=3 msz=0 scale=0
 +LD1_zprz        1100010 01 1. ..... 1.. ... ..... ..... \
 +                @rprr_g_load_u_sc esz=3 msz=1
 +LD1_zprz        1100010 10 1. ..... 1.. ... ..... ..... \
 +                @rprr_g_load_u_sc esz=3 msz=2
 +LD1_zprz        1100010 11 1. ..... 11. ... ..... ..... \
 +                @rprr_g_load_sc esz=3 msz=3 u=1
 +
 +# SVE 64-bit gather load (vector plus immediate)
 +LD1_zpiz        1100010 .. 01 ..... 1.. ... ..... ..... \
 +                @rpri_g_load esz=3
 +
  # SVE 64-bit gather prefetch (scalar plus 64-bit scaled offsets)
  PRF             1100010 00 11 ----- 1-- --- ----- 0 ----
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 36/55] target/arm: Pass index to AdvSIMD FCMLA (indexed)
+[Qemu-devel] [PULL 22/42] target/arm: Activate M-profile floating point context when FPCCR.ASPEN is set
-From: Richard Henderson <richard.henderson@linaro.org>
+The M-profile FPCCR.ASPEN bit indicates that automatic floating-point
 context preservation is enabled. Before executing any floating-point
 instruction, if FPCCR.ASPEN is set and the CONTROL FPCA/SFPA bits
 indicate that there is no active floating point context then we
 must create a new context (by initializing FPSCR and setting
 FPCA/SFPA to indicate that the context is now active). In the
 pseudocode this is handled by ExecuteFPCheck().
-For aa64 advsimd, we had been passing the pre-indexed vector.
+Implement this with a new TB flag which tracks whether we
-However, sve applies the index to each 128-bit segment, so we
+need to create a new FP context.
 need to pass in the index separately.
-For aa32 advsimd, the fp32 operation always has index 0, but
+Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
-we failed to interpret the fp16 index correctly.
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
 Message-id: 20190416125744.27770-20-peter.maydell@linaro.org
 ---
  target/arm/cpu.h       |  2 ++
  target/arm/translate.h |  1 +
  target/arm/helper.c    | 13 +++++++++++++
  target/arm/translate.c | 29 +++++++++++++++++++++++++++++
 files changed, 45 insertions(+)
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+diff --git a/target/arm/cpu.h b/target/arm/cpu.h
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Reviewed-by: Alex Bennée <alex.bennee@linaro.org>
 Message-id: 20180627043328.11531-31-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
  target/arm/translate-a64.c | 21 ++++++++++++---------
  target/arm/translate.c     | 32 +++++++++++++++++++++++---------
  target/arm/vec_helper.c    | 10 ++++++----
 files changed, 41 insertions(+), 22 deletions(-)
 diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-a64.c
+--- a/target/arm/cpu.h
-+++ b/target/arm/translate-a64.c
++++ b/target/arm/cpu.h
-@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ FIELD(TBFLAG_A32, NS, 6, 1)
-     case 0x13: /* FCMLA #90 */
+ FIELD(TBFLAG_A32, VFPEN, 7, 1)
-     case 0x15: /* FCMLA #180 */
+ FIELD(TBFLAG_A32, CONDEXEC, 8, 8)
-     case 0x17: /* FCMLA #270 */
+ FIELD(TBFLAG_A32, SCTLR_B, 16, 1)
--        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, rd),
++/* For M profile only, set if we must create a new FP context */
--                           vec_full_reg_offset(s, rn),
++FIELD(TBFLAG_A32, NEW_FP_CTXT_NEEDED, 19, 1)
--                           vec_reg_offset(s, rm, index, size), fpst,
+ /* For M profile only, set if FPCCR.S does not match current security state */
--                           is_q ? 16 : 8, vec_full_reg_size(s),
+ FIELD(TBFLAG_A32, FPCCR_S_WRONG, 20, 1)
--                           extract32(insn, 13, 2), /* rot */
+ /* For M profile only, Handler (ie not Thread) mode */
--                           size == MO_64
+diff --git a/target/arm/translate.h b/target/arm/translate.h
--                           ? gen_helper_gvec_fcmlas_idx
+index XXXXXXX..XXXXXXX 100644
--                           : gen_helper_gvec_fcmlah_idx);
+--- a/target/arm/translate.h
--        tcg_temp_free_ptr(fpst);
++++ b/target/arm/translate.h
-+        {
+@@ -XXX,XX +XXX,XX @@ typedef struct DisasContext {
-+            int rot = extract32(insn, 13, 2);
+     bool v8m_secure; /* true if v8M and we're in Secure mode */
-+            int data = (index << 2) | rot;
+     bool v8m_stackcheck; /* true if we need to perform v8M stack limit checks */
-+            tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, rd),
+     bool v8m_fpccr_s_wrong; /* true if v8M FPCCR.S != v8m_secure */
-+                               vec_full_reg_offset(s, rn),
++    bool v7m_new_fp_ctxt_needed; /* ASPEN set but no active FP context */
-+                               vec_full_reg_offset(s, rm), fpst,
+     /* Immediate value in AArch32 SVC insn; must be set if is_jmp == DISAS_SWI
-+                               is_q ? 16 : 8, vec_full_reg_size(s), data,
+      * so that top level loop can generate correct syndrome information.
-+                               size == MO_64
+      */
-+                               ? gen_helper_gvec_fcmlas_idx
+diff --git a/target/arm/helper.c b/target/arm/helper.c
-+                               : gen_helper_gvec_fcmlah_idx);
+index XXXXXXX..XXXXXXX 100644
-+            tcg_temp_free_ptr(fpst);
+--- a/target/arm/helper.c
-+        }
++++ b/target/arm/helper.c
-         return;
+@@ -XXX,XX +XXX,XX @@ void cpu_get_tb_cpu_state(CPUARMState *env, target_ulong *pc,
          flags = FIELD_DP32(flags, TBFLAG_A32, FPCCR_S_WRONG, 1);
      }
++    if (arm_feature(env, ARM_FEATURE_M) &&
++        (env->v7m.fpccr[env->v7m.secure] & R_V7M_FPCCR_ASPEN_MASK) &&
++        (!(env->v7m.control[M_REG_S] & R_V7M_CONTROL_FPCA_MASK) ||
++         (env->v7m.secure &&
++          !(env->v7m.control[M_REG_S] & R_V7M_CONTROL_SFPA_MASK)))) {
++        /*
++         * ASPEN is set, but FPCA/SFPA indicate that there is no active
++         * FP context; we must create a new FP context before executing
++         * any FP insn.
++         */
++        flags = FIELD_DP32(flags, TBFLAG_A32, NEW_FP_CTXT_NEEDED, 1);
++    }
++
+     *pflags = flags;
+     *cs_base = 0;
+ }
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@ static int disas_vfp_insn(DisasContext *s, uint32_t insn)
+             /* Don't need to do this for any further FP insns in this TB */
- static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
+             s->v8m_fpccr_s_wrong = false;
- {
+         }
--    int rd, rn, rm, rot, size, opr_sz;
++
-+    gen_helper_gvec_3_ptr *fn_gvec_ptr;
++        if (s->v7m_new_fp_ctxt_needed) {
-+    int rd, rn, rm, opr_sz, data;
++            /*
-     TCGv_ptr fpst;
++             * Create new FP context by updating CONTROL.FPCA, CONTROL.SFPA
-     bool q;
++             * and the FPSCR.
++             */
-     q = extract32(insn, 6, 1);
++            TCGv_i32 control, fpscr;
-     VFP_DREG_D(rd, insn);
++            uint32_t bits = R_V7M_CONTROL_FPCA_MASK;
-     VFP_DREG_N(rn, insn);
++
--    VFP_DREG_M(rm, insn);
++            fpscr = load_cpu_field(v7m.fpdscr[s->v8m_secure]);
-     if ((rd | rn) & q) {
++            gen_helper_vfp_set_fpscr(cpu_env, fpscr);
-         return 1;
++            tcg_temp_free_i32(fpscr);
 +            /*
 +             * We don't need to arrange to end the TB, because the only
 +             * parts of FPSCR which we cache in the TB flags are the VECLEN
 +             * and VECSTRIDE, and those don't exist for M-profile.
 +             */
 +
 +            if (s->v8m_secure) {
 +                bits |= R_V7M_CONTROL_SFPA_MASK;
 +            }
 +            control = load_cpu_field(v7m.control[M_REG_S]);
 +            tcg_gen_ori_i32(control, control, bits);
 +            store_cpu_field(control, v7m.control[M_REG_S]);
 +            /* Don't need to do this for any further FP insns in this TB */
 +            s->v7m_new_fp_ctxt_needed = false;
 +        }
      }
-     if ((insn & 0xff000f10) == 0xfe000800) {
+     if (extract32(insn, 28, 4) == 0xf) {
-         /* VCMLA (indexed) -- 1111 1110 S.RR .... .... 1000 ...0 .... */
+@@ -XXX,XX +XXX,XX @@ static void arm_tr_init_disas_context(DisasContextBase *dcbase, CPUState *cs)
--        rot = extract32(insn, 20, 2);
+         regime_is_secure(env, dc->mmu_idx);
--        size = extract32(insn, 23, 1);
+     dc->v8m_stackcheck = FIELD_EX32(tb_flags, TBFLAG_A32, STACKCHECK);
--        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)
+     dc->v8m_fpccr_s_wrong = FIELD_EX32(tb_flags, TBFLAG_A32, FPCCR_S_WRONG);
--            || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
++    dc->v7m_new_fp_ctxt_needed =
-+        int rot = extract32(insn, 20, 2);
++        FIELD_EX32(tb_flags, TBFLAG_A32, NEW_FP_CTXT_NEEDED);
-+        int size = extract32(insn, 23, 1);
+     dc->cp_regs = cpu->cp_regs;
-+        int index;
+     dc->features = env->features;
-+
 +        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)) {
              return 1;
          }
 +        if (size == 0) {
 +            if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
 +                return 1;
 +            }
 +            /* For fp16, rm is just Vm, and index is M.  */
 +            rm = extract32(insn, 0, 4);
 +            index = extract32(insn, 5, 1);
 +        } else {
 +            /* For fp32, rm is the usual M:Vm, and index is 0.  */
 +            VFP_DREG_M(rm, insn);
 +            index = 0;
 +        }
 +        data = (index << 2) | rot;
 +        fn_gvec_ptr = (size ? gen_helper_gvec_fcmlas_idx
 +                       : gen_helper_gvec_fcmlah_idx);
      } else {
          return 1;
      }
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
      tcg_gen_gvec_3_ptr(vfp_reg_offset(1, rd),
                         vfp_reg_offset(1, rn),
                         vfp_reg_offset(1, rm), fpst,
 -                       opr_sz, opr_sz, rot,
 -                       size ? gen_helper_gvec_fcmlas_idx
 -                       : gen_helper_gvec_fcmlah_idx);
 +                       opr_sz, opr_sz, data, fn_gvec_ptr);
      tcg_temp_free_ptr(fpst);
      return 0;
  }
 diff --git a/target/arm/vec_helper.c b/target/arm/vec_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/vec_helper.c
 +++ b/target/arm/vec_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(gvec_fcmlah_idx)(void *vd, void *vn, void *vm,
      float_status *fpst = vfpst;
      intptr_t flip = extract32(desc, SIMD_DATA_SHIFT, 1);
      uint32_t neg_imag = extract32(desc, SIMD_DATA_SHIFT + 1, 1);
 +    intptr_t index = extract32(desc, SIMD_DATA_SHIFT + 2, 2);
      uint32_t neg_real = flip ^ neg_imag;
      uintptr_t i;
 -    float16 e1 = m[H2(flip)];
 -    float16 e3 = m[H2(1 - flip)];
 +    float16 e1 = m[H2(2 * index + flip)];
 +    float16 e3 = m[H2(2 * index + 1 - flip)];
      /* Shift boolean to the sign bit so we can xor to negate.  */
      neg_real <<= 15;
@@ -XXX,XX +XXX,XX @@ void HELPER(gvec_fcmlas_idx)(void *vd, void *vn, void *vm,
      float_status *fpst = vfpst;
      intptr_t flip = extract32(desc, SIMD_DATA_SHIFT, 1);
      uint32_t neg_imag = extract32(desc, SIMD_DATA_SHIFT + 1, 1);
 +    intptr_t index = extract32(desc, SIMD_DATA_SHIFT + 2, 2);
      uint32_t neg_real = flip ^ neg_imag;
      uintptr_t i;
 -    float32 e1 = m[H4(flip)];
 -    float32 e3 = m[H4(1 - flip)];
 +    float32 e1 = m[H4(2 * index + flip)];
 +    float32 e3 = m[H4(2 * index + 1 - flip)];
      /* Shift boolean to the sign bit so we can xor to negate.  */
      neg_real <<= 31;
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 55/55] target/arm: Add ID_ISAR6
+[Qemu-devel] [PULL 23/42] target/arm: New helper function arm_v7m_mmu_idx_all()
-From: Richard Henderson <richard.henderson@linaro.org>
+Add a new helper function which returns the MMU index to use
 for v7M, where the caller specifies all of the security
 state, privilege level and whether the execution priority
 is negative, and reimplement the existing
 arm_v7m_mmu_idx_for_secstate_and_priv() in terms of it.
-This register was added to aa32 state by ARMv8.2.
+We are going to need this for the lazy-FP-stacking code.
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Message-id: 20180629001538.11415-6-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-21-peter.maydell@linaro.org
 ---
- target/arm/cpu.h    | 1 +
+ target/arm/cpu.h    |  7 +++++++
- target/arm/cpu.c    | 4 ++++
+ target/arm/helper.c | 14 +++++++++++---
- target/arm/cpu64.c  | 2 ++
+files changed, 18 insertions(+), 3 deletions(-)
  target/arm/helper.c | 5 ++---
 files changed, 9 insertions(+), 3 deletions(-)
 diff --git a/target/arm/cpu.h b/target/arm/cpu.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu.h
 +++ b/target/arm/cpu.h
-@@ -XXX,XX +XXX,XX @@ struct ARMCPU {
+@@ -XXX,XX +XXX,XX @@ static inline int arm_mmu_idx_to_el(ARMMMUIdx mmu_idx)
-     uint32_t id_isar3;
+     }
      uint32_t id_isar4;
      uint32_t id_isar5;
 +    uint32_t id_isar6;
      uint64_t id_aa64pfr0;
      uint64_t id_aa64pfr1;
      uint64_t id_aa64dfr0;
 diff --git a/target/arm/cpu.c b/target/arm/cpu.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu.c
 +++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void cortex_m3_initfn(Object *obj)
      cpu->id_isar3 = 0x01111110;
      cpu->id_isar4 = 0x01310102;
      cpu->id_isar5 = 0x00000000;
 +    cpu->id_isar6 = 0x00000000;
  }
- static void cortex_m4_initfn(Object *obj)
++/*
-@@ -XXX,XX +XXX,XX @@ static void cortex_m4_initfn(Object *obj)
++ * Return the MMU index for a v7M CPU with all relevant information
-     cpu->id_isar3 = 0x01111110;
++ * manually specified.
-     cpu->id_isar4 = 0x01310102;
++ */
-     cpu->id_isar5 = 0x00000000;
++ARMMMUIdx arm_v7m_mmu_idx_all(CPUARMState *env,
-+    cpu->id_isar6 = 0x00000000;
++                              bool secstate, bool priv, bool negpri);
- }
++
+ /* Return the MMU index for a v7M CPU in the specified security and
- static void cortex_m33_initfn(Object *obj)
+  * privilege state.
-@@ -XXX,XX +XXX,XX @@ static void cortex_m33_initfn(Object *obj)
+  */
      cpu->id_isar3 = 0x01111131;
      cpu->id_isar4 = 0x01310132;
      cpu->id_isar5 = 0x00000000;
 +    cpu->id_isar6 = 0x00000000;
      cpu->clidr = 0x00000000;
      cpu->ctr = 0x8000c000;
  }
@@ -XXX,XX +XXX,XX @@ static void cortex_r5_initfn(Object *obj)
      cpu->id_isar3 = 0x01112131;
      cpu->id_isar4 = 0x0010142;
      cpu->id_isar5 = 0x0;
 +    cpu->id_isar6 = 0x0;
      cpu->mp_is_up = true;
      cpu->pmsav7_dregion = 16;
      define_arm_cp_regs(cpu, cortexr5_cp_reginfo);
 diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu64.c
 +++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_a57_initfn(Object *obj)
      cpu->id_isar3 = 0x01112131;
      cpu->id_isar4 = 0x00011142;
      cpu->id_isar5 = 0x00011121;
 +    cpu->id_isar6 = 0;
      cpu->id_aa64pfr0 = 0x00002222;
      cpu->id_aa64dfr0 = 0x10305106;
      cpu->pmceid0 = 0x00000000;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a53_initfn(Object *obj)
      cpu->id_isar3 = 0x01112131;
      cpu->id_isar4 = 0x00011142;
      cpu->id_isar5 = 0x00011121;
 +    cpu->id_isar6 = 0;
      cpu->id_aa64pfr0 = 0x00002222;
      cpu->id_aa64dfr0 = 0x10305106;
      cpu->id_aa64isar0 = 0x00011120;
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
+@@ -XXX,XX +XXX,XX @@ int fp_exception_el(CPUARMState *env, int cur_el)
-               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 6,
+     return 0;
-               .access = PL1_R, .type = ARM_CP_CONST,
+ }
-               .resetvalue = cpu->id_mmfr4 },
--            /* 7 is as yet unallocated and must RAZ */
+-ARMMMUIdx arm_v7m_mmu_idx_for_secstate_and_priv(CPUARMState *env,
--            { .name = "ID_ISAR7_RESERVED", .state = ARM_CP_STATE_BOTH,
+-                                                bool secstate, bool priv)
-+            { .name = "ID_ISAR6", .state = ARM_CP_STATE_BOTH,
++ARMMMUIdx arm_v7m_mmu_idx_all(CPUARMState *env,
-               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 7,
++                              bool secstate, bool priv, bool negpri)
-               .access = PL1_R, .type = ARM_CP_CONST,
+ {
--              .resetvalue = 0 },
+     ARMMMUIdx mmu_idx = ARM_MMU_IDX_M;
-+              .resetvalue = cpu->id_isar6 },
-             REGINFO_SENTINEL
+@@ -XXX,XX +XXX,XX @@ ARMMMUIdx arm_v7m_mmu_idx_for_secstate_and_priv(CPUARMState *env,
-         };
+         mmu_idx |= ARM_MMU_IDX_M_PRIV;
-         define_arm_cp_regs(cpu, v6_idregs);
+     }
 -    if (armv7m_nvic_neg_prio_requested(env->nvic, secstate)) {
 +    if (negpri) {
          mmu_idx |= ARM_MMU_IDX_M_NEGPRI;
      }
@@ -XXX,XX +XXX,XX @@ ARMMMUIdx arm_v7m_mmu_idx_for_secstate_and_priv(CPUARMState *env,
      return mmu_idx;
  }
 +ARMMMUIdx arm_v7m_mmu_idx_for_secstate_and_priv(CPUARMState *env,
 +                                                bool secstate, bool priv)
 +{
 +    bool negpri = armv7m_nvic_neg_prio_requested(env->nvic, secstate);
 +
 +    return arm_v7m_mmu_idx_all(env, secstate, priv, negpri);
 +}
 +
  /* Return the MMU index for a v7M CPU in the specified security state */
  ARMMMUIdx arm_v7m_mmu_idx_for_secstate(CPUARMState *env, bool secstate)
  {
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 04/55] device_tree: Add qemu_fdt_node_unit_path
+[Qemu-devel] [PULL 24/42] target/arm: New function armv7m_nvic_set_pending_lazyfp()
-From: Eric Auger <eric.auger@redhat.com>
+In the v7M architecture, if an exception is generated in the process
 of doing the lazy stacking of FP registers, the handling of
 possible escalation to HardFault is treated differently to the normal
 approach: it works based on the saved information about exception
 readiness that was stored in the FPCCR when the stack frame was
 created. Provide a new function armv7m_nvic_set_pending_lazyfp()
 which pends exceptions during lazy stacking, and implements
 this logic.
-This helper allows to retrieve the paths of nodes whose name
+This corresponds to the pseudocode TakePreserveFPException().
 match node-name or node-name@unit-address patterns.
-Signed-off-by: Eric Auger <eric.auger@redhat.com>
-Message-id: 1530044492-24921-2-git-send-email-eric.auger@redhat.com
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-22-peter.maydell@linaro.org
 ---
- include/sysemu/device_tree.h | 16 +++++++++++
+ target/arm/cpu.h      | 12 ++++++
- device_tree.c                | 55 ++++++++++++++++++++++++++++++++++++
+ hw/intc/armv7m_nvic.c | 96 +++++++++++++++++++++++++++++++++++++++++++
-files changed, 71 insertions(+)
+files changed, 108 insertions(+)
-diff --git a/include/sysemu/device_tree.h b/include/sysemu/device_tree.h
+diff --git a/target/arm/cpu.h b/target/arm/cpu.h
 index XXXXXXX..XXXXXXX 100644
---- a/include/sysemu/device_tree.h
+--- a/target/arm/cpu.h
-+++ b/include/sysemu/device_tree.h
++++ b/target/arm/cpu.h
-@@ -XXX,XX +XXX,XX @@ void *load_device_tree_from_sysfs(void);
+@@ -XXX,XX +XXX,XX @@ void armv7m_nvic_set_pending(void *opaque, int irq, bool secure);
- char **qemu_fdt_node_path(void *fdt, const char *name, char *compat,
+  * a different exception).
-                           Error **errp);
+  */
+ void armv7m_nvic_set_pending_derived(void *opaque, int irq, bool secure);
 +/**
-+ * qemu_fdt_node_unit_path: return the paths of nodes matching a given
++ * armv7m_nvic_set_pending_lazyfp: mark this lazy FP exception as pending
-+ * node-name, ie. node-name and node-name@unit-address
++ * @opaque: the NVIC
-+ * @fdt: pointer to the dt blob
++ * @irq: the exception number to mark pending
-+ * @name: node name
++ * @secure: false for non-banked exceptions or for the nonsecure
-+ * @errp: handle to an error object
++ * version of a banked exception, true for the secure version of a banked
 + * exception.
 + *
-+ * returns a newly allocated NULL-terminated array of node paths.
++ * Similar to armv7m_nvic_set_pending(), but specifically for exceptions
-+ * Use g_strfreev() to free it. If one or more nodes were found, the
++ * generated in the course of lazy stacking of FP registers.
 + * array contains the path of each node and the last element equals to
 + * NULL. If there is no error but no matching node was found, the
 + * returned array contains a single element equal to NULL. If an error
 + * was encountered when parsing the blob, the function returns NULL
 + */
-+char **qemu_fdt_node_unit_path(void *fdt, const char *name, Error **errp);
++void armv7m_nvic_set_pending_lazyfp(void *opaque, int irq, bool secure);
  /**
   * armv7m_nvic_get_pending_irq_info: return highest priority pending
   *    exception, and whether it targets Secure state
 diff --git a/hw/intc/armv7m_nvic.c b/hw/intc/armv7m_nvic.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/intc/armv7m_nvic.c
 +++ b/hw/intc/armv7m_nvic.c
@@ -XXX,XX +XXX,XX @@ void armv7m_nvic_set_pending_derived(void *opaque, int irq, bool secure)
      do_armv7m_nvic_set_pending(opaque, irq, secure, true);
  }
 +void armv7m_nvic_set_pending_lazyfp(void *opaque, int irq, bool secure)
 +{
 +    /*
 +     * Pend an exception during lazy FP stacking. This differs
 +     * from the usual exception pending because the logic for
 +     * whether we should escalate depends on the saved context
 +     * in the FPCCR register, not on the current state of the CPU/NVIC.
 +     */
 +    NVICState *s = (NVICState *)opaque;
 +    bool banked = exc_is_banked(irq);
 +    VecInfo *vec;
 +    bool targets_secure;
 +    bool escalate = false;
 +    /*
 +     * We will only look at bits in fpccr if this is a banked exception
 +     * (in which case 'secure' tells us whether it is the S or NS version).
 +     * All the bits for the non-banked exceptions are in fpccr_s.
 +     */
 +    uint32_t fpccr_s = s->cpu->env.v7m.fpccr[M_REG_S];
 +    uint32_t fpccr = s->cpu->env.v7m.fpccr[secure];
 +
- int qemu_fdt_setprop(void *fdt, const char *node_path,
++    assert(irq > ARMV7M_EXCP_RESET && irq < s->num_irq);
-                      const char *property, const void *val, int size);
++    assert(!secure || banked);
  int qemu_fdt_setprop_cell(void *fdt, const char *node_path,
 diff --git a/device_tree.c b/device_tree.c
 index XXXXXXX..XXXXXXX 100644
 --- a/device_tree.c
 +++ b/device_tree.c
@@ -XXX,XX +XXX,XX @@ static int findnode_nofail(void *fdt, const char *node_path)
      return offset;
  }
 +char **qemu_fdt_node_unit_path(void *fdt, const char *name, Error **errp)
 +{
 +    char *prefix =  g_strdup_printf("%s@", name);
 +    unsigned int path_len = 16, n = 0;
 +    GSList *path_list = NULL, *iter;
 +    const char *iter_name;
 +    int offset, len, ret;
 +    char **path_array;
 +
-+    offset = fdt_next_node(fdt, -1, NULL);
++    vec = (banked && secure) ? &s->sec_vectors[irq] : &s->vectors[irq];
 +
-+    while (offset >= 0) {
++    targets_secure = banked ? secure : exc_targets_secure(s, irq);
-+        iter_name = fdt_get_name(fdt, offset, &len);
++
-+        if (!iter_name) {
++    switch (irq) {
-+            offset = len;
++    case ARMV7M_EXCP_DEBUG:
-+            break;
++        if (!(fpccr_s & R_V7M_FPCCR_MONRDY_MASK)) {
 +            /* Ignore DebugMonitor exception */
 +            return;
 +        }
-+        if (!strcmp(iter_name, name) || g_str_has_prefix(iter_name, prefix)) {
++        break;
-+            char *path;
++    case ARMV7M_EXCP_MEM:
-+
++        escalate = !(fpccr & R_V7M_FPCCR_MMRDY_MASK);
-+            path = g_malloc(path_len);
++        break;
-+            while ((ret = fdt_get_path(fdt, offset, path, path_len))
++    case ARMV7M_EXCP_USAGE:
-+                  == -FDT_ERR_NOSPACE) {
++        escalate = !(fpccr & R_V7M_FPCCR_UFRDY_MASK);
-+                path_len += 16;
++        break;
-+                path = g_realloc(path, path_len);
++    case ARMV7M_EXCP_BUS:
-+            }
++        escalate = !(fpccr_s & R_V7M_FPCCR_BFRDY_MASK);
-+            path_list = g_slist_prepend(path_list, path);
++        break;
-+            n++;
++    case ARMV7M_EXCP_SECURE:
-+        }
++        escalate = !(fpccr_s & R_V7M_FPCCR_SFRDY_MASK);
-+        offset = fdt_next_node(fdt, offset, NULL);
++        break;
-+    }
++    default:
-+    g_free(prefix);
++        g_assert_not_reached();
 +
 +    if (offset < 0 && offset != -FDT_ERR_NOTFOUND) {
 +        error_setg(errp, "%s: abort parsing dt for %s node units: %s",
 +                   __func__, name, fdt_strerror(offset));
 +        for (iter = path_list; iter; iter = iter->next) {
 +            g_free(iter->data);
 +        }
 +        g_slist_free(path_list);
 +        return NULL;
 +    }
 +
-+    path_array = g_new(char *, n + 1);
++    if (escalate) {
-+    path_array[n--] = NULL;
++        /*
-+
++         * Escalate to HardFault: faults that initially targeted Secure
-+    for (iter = path_list; iter; iter = iter->next) {
++         * continue to do so, even if HF normally targets NonSecure.
-+        path_array[n--] = iter->data;
++         */
 +        irq = ARMV7M_EXCP_HARD;
 +        if (arm_feature(&s->cpu->env, ARM_FEATURE_M_SECURITY) &&
 +            (targets_secure ||
 +             !(s->cpu->env.v7m.aircr & R_V7M_AIRCR_BFHFNMINS_MASK))) {
 +            vec = &s->sec_vectors[irq];
 +        } else {
 +            vec = &s->vectors[irq];
 +        }
 +    }
 +
-+    g_slist_free(path_list);
++    if (!vec->enabled ||
 +        nvic_exec_prio(s) <= exc_group_prio(s, vec->prio, secure)) {
 +        if (!(fpccr_s & R_V7M_FPCCR_HFRDY_MASK)) {
 +            /*
 +             * We want to escalate to HardFault but the context the
 +             * FP state belongs to prevents the exception pre-empting.
 +             */
 +            cpu_abort(&s->cpu->parent_obj,
 +                      "Lockup: can't escalate to HardFault during "
 +                      "lazy FP register stacking\n");
 +        }
 +    }
 +
-+    return path_array;
++    if (escalate) {
 +        s->cpu->env.v7m.hfsr |= R_V7M_HFSR_FORCED_MASK;
 +    }
 +    if (!vec->pending) {
 +        vec->pending = 1;
 +        /*
 +         * We do not call nvic_irq_update(), because we know our caller
 +         * is going to handle causing us to take the exception by
 +         * raising EXCP_LAZYFP, so raising the IRQ line would be
 +         * pointless extra work. We just need to recompute the
 +         * priorities so that armv7m_nvic_can_take_pending_exception()
 +         * returns the right answer.
 +         */
 +        nvic_recompute_state(s);
 +    }
 +}
 +
- char **qemu_fdt_node_path(void *fdt, const char *name, char *compat,
+ /* Make pending IRQ active.  */
-                           Error **errp)
+ void armv7m_nvic_acknowledge_irq(void *opaque)
  {
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 07/55] target/arm: Implement SVE Memory Contiguous Load Group
+Deleted patch
-From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Alex Bennée <alex.bennee@linaro.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20180627043328.11531-2-richard.henderson@linaro.org
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
----
- target/arm/helper-sve.h    |  35 +++++++++
- target/arm/sve_helper.c    | 153 +++++++++++++++++++++++++++++++++++++
- target/arm/translate-sve.c | 121 +++++++++++++++++++++++++++++
- target/arm/sve.decode      |  34 +++++++++
-files changed, 343 insertions(+)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
-+++ b/target/arm/helper-sve.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_5(gvec_rsqrts_s, TCG_CALL_NO_RWG,
-                    void, ptr, ptr, ptr, ptr, i32)
- DEF_HELPER_FLAGS_5(gvec_rsqrts_d, TCG_CALL_NO_RWG,
-                    void, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_4(sve_ld1bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld2bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld3bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld4bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+
-+DEF_HELPER_FLAGS_4(sve_ld1hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld2hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld3hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld4hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+
-+DEF_HELPER_FLAGS_4(sve_ld1ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld2ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld3ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld4ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+
-+DEF_HELPER_FLAGS_4(sve_ld1dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld2dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld3dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld4dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+
-+DEF_HELPER_FLAGS_4(sve_ld1bhu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld1bsu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld1bdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld1bhs_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld1bss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld1bds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+
-+DEF_HELPER_FLAGS_4(sve_ld1hsu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld1hdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld1hss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld1hds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+
-+DEF_HELPER_FLAGS_4(sve_ld1sdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_ld1sds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve_helper.c
-+++ b/target/arm/sve_helper.c
-@@ -XXX,XX +XXX,XX @@ uint32_t HELPER(sve_while)(void *vd, uint32_t count, uint32_t pred_desc)
-     return predtest_ones(d, oprsz, esz_mask);
- }
-+
-+/*
-+ * Load contiguous data, protected by a governing predicate.
-+ */
-+#define DO_LD1(NAME, FN, TYPEE, TYPEM, H)                  \
-+static void do_##NAME(CPUARMState *env, void *vd, void *vg, \
-+                      target_ulong addr, intptr_t oprsz,   \
-+                      uintptr_t ra)                        \
-+{                                                          \
-+    intptr_t i = 0;                                        \
-+    do {                                                   \
-+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));    \
-+        do {                                               \
-+            TYPEM m = 0;                                   \
-+            if (pg & 1) {                                  \
-+                m = FN(env, addr, ra);                     \
-+            }                                              \
-+            *(TYPEE *)(vd + H(i)) = m;                     \
-+            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);      \
-+            addr += sizeof(TYPEM);                         \
-+        } while (i & 15);                                  \
-+    } while (i < oprsz);                                   \
-+}                                                          \
-+void HELPER(NAME)(CPUARMState *env, void *vg,              \
-+                  target_ulong addr, uint32_t desc)        \
-+{                                                          \
-+    do_##NAME(env, &env->vfp.zregs[simd_data(desc)], vg,   \
-+              addr, simd_oprsz(desc), GETPC());            \
-+}
-+
-+#define DO_LD2(NAME, FN, TYPEE, TYPEM, H)                  \
-+void HELPER(NAME)(CPUARMState *env, void *vg,              \
-+                  target_ulong addr, uint32_t desc)        \
-+{                                                          \
-+    intptr_t i, oprsz = simd_oprsz(desc);                  \
-+    intptr_t ra = GETPC();                                 \
-+    unsigned rd = simd_data(desc);                         \
-+    void *d1 = &env->vfp.zregs[rd];                        \
-+    void *d2 = &env->vfp.zregs[(rd + 1) & 31];             \
-+    for (i = 0; i < oprsz; ) {                             \
-+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));    \
-+        do {                                               \
-+            TYPEM m1 = 0, m2 = 0;                          \
-+            if (pg & 1) {                                  \
-+                m1 = FN(env, addr, ra);                    \
-+                m2 = FN(env, addr + sizeof(TYPEM), ra);    \
-+            }                                              \
-+            *(TYPEE *)(d1 + H(i)) = m1;                    \
-+            *(TYPEE *)(d2 + H(i)) = m2;                    \
-+            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);      \
-+            addr += 2 * sizeof(TYPEM);                     \
-+        } while (i & 15);                                  \
-+    }                                                      \
-+}
-+
-+#define DO_LD3(NAME, FN, TYPEE, TYPEM, H)                  \
-+void HELPER(NAME)(CPUARMState *env, void *vg,              \
-+                  target_ulong addr, uint32_t desc)        \
-+{                                                          \
-+    intptr_t i, oprsz = simd_oprsz(desc);                  \
-+    intptr_t ra = GETPC();                                 \
-+    unsigned rd = simd_data(desc);                         \
-+    void *d1 = &env->vfp.zregs[rd];                        \
-+    void *d2 = &env->vfp.zregs[(rd + 1) & 31];             \
-+    void *d3 = &env->vfp.zregs[(rd + 2) & 31];             \
-+    for (i = 0; i < oprsz; ) {                             \
-+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));    \
-+        do {                                               \
-+            TYPEM m1 = 0, m2 = 0, m3 = 0;                  \
-+            if (pg & 1) {                                  \
-+                m1 = FN(env, addr, ra);                    \
-+                m2 = FN(env, addr + sizeof(TYPEM), ra);    \
-+                m3 = FN(env, addr + 2 * sizeof(TYPEM), ra); \
-+            }                                              \
-+            *(TYPEE *)(d1 + H(i)) = m1;                    \
-+            *(TYPEE *)(d2 + H(i)) = m2;                    \
-+            *(TYPEE *)(d3 + H(i)) = m3;                    \
-+            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);      \
-+            addr += 3 * sizeof(TYPEM);                     \
-+        } while (i & 15);                                  \
-+    }                                                      \
-+}
-+
-+#define DO_LD4(NAME, FN, TYPEE, TYPEM, H)                  \
-+void HELPER(NAME)(CPUARMState *env, void *vg,              \
-+                  target_ulong addr, uint32_t desc)        \
-+{                                                          \
-+    intptr_t i, oprsz = simd_oprsz(desc);                  \
-+    intptr_t ra = GETPC();                                 \
-+    unsigned rd = simd_data(desc);                         \
-+    void *d1 = &env->vfp.zregs[rd];                        \
-+    void *d2 = &env->vfp.zregs[(rd + 1) & 31];             \
-+    void *d3 = &env->vfp.zregs[(rd + 2) & 31];             \
-+    void *d4 = &env->vfp.zregs[(rd + 3) & 31];             \
-+    for (i = 0; i < oprsz; ) {                             \
-+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));    \
-+        do {                                               \
-+            TYPEM m1 = 0, m2 = 0, m3 = 0, m4 = 0;          \
-+            if (pg & 1) {                                  \
-+                m1 = FN(env, addr, ra);                    \
-+                m2 = FN(env, addr + sizeof(TYPEM), ra);    \
-+                m3 = FN(env, addr + 2 * sizeof(TYPEM), ra); \
-+                m4 = FN(env, addr + 3 * sizeof(TYPEM), ra); \
-+            }                                              \
-+            *(TYPEE *)(d1 + H(i)) = m1;                    \
-+            *(TYPEE *)(d2 + H(i)) = m2;                    \
-+            *(TYPEE *)(d3 + H(i)) = m3;                    \
-+            *(TYPEE *)(d4 + H(i)) = m4;                    \
-+            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);      \
-+            addr += 4 * sizeof(TYPEM);                     \
-+        } while (i & 15);                                  \
-+    }                                                      \
-+}
-+
-+DO_LD1(sve_ld1bhu_r, cpu_ldub_data_ra, uint16_t, uint8_t, H1_2)
-+DO_LD1(sve_ld1bhs_r, cpu_ldsb_data_ra, uint16_t, int8_t, H1_2)
-+DO_LD1(sve_ld1bsu_r, cpu_ldub_data_ra, uint32_t, uint8_t, H1_4)
-+DO_LD1(sve_ld1bss_r, cpu_ldsb_data_ra, uint32_t, int8_t, H1_4)
-+DO_LD1(sve_ld1bdu_r, cpu_ldub_data_ra, uint64_t, uint8_t, )
-+DO_LD1(sve_ld1bds_r, cpu_ldsb_data_ra, uint64_t, int8_t, )
-+
-+DO_LD1(sve_ld1hsu_r, cpu_lduw_data_ra, uint32_t, uint16_t, H1_4)
-+DO_LD1(sve_ld1hss_r, cpu_ldsw_data_ra, uint32_t, int8_t, H1_4)
-+DO_LD1(sve_ld1hdu_r, cpu_lduw_data_ra, uint64_t, uint16_t, )
-+DO_LD1(sve_ld1hds_r, cpu_ldsw_data_ra, uint64_t, int16_t, )
-+
-+DO_LD1(sve_ld1sdu_r, cpu_ldl_data_ra, uint64_t, uint32_t, )
-+DO_LD1(sve_ld1sds_r, cpu_ldl_data_ra, uint64_t, int32_t, )
-+
-+DO_LD1(sve_ld1bb_r, cpu_ldub_data_ra, uint8_t, uint8_t, H1)
-+DO_LD2(sve_ld2bb_r, cpu_ldub_data_ra, uint8_t, uint8_t, H1)
-+DO_LD3(sve_ld3bb_r, cpu_ldub_data_ra, uint8_t, uint8_t, H1)
-+DO_LD4(sve_ld4bb_r, cpu_ldub_data_ra, uint8_t, uint8_t, H1)
-+
-+DO_LD1(sve_ld1hh_r, cpu_lduw_data_ra, uint16_t, uint16_t, H1_2)
-+DO_LD2(sve_ld2hh_r, cpu_lduw_data_ra, uint16_t, uint16_t, H1_2)
-+DO_LD3(sve_ld3hh_r, cpu_lduw_data_ra, uint16_t, uint16_t, H1_2)
-+DO_LD4(sve_ld4hh_r, cpu_lduw_data_ra, uint16_t, uint16_t, H1_2)
-+
-+DO_LD1(sve_ld1ss_r, cpu_ldl_data_ra, uint32_t, uint32_t, H1_4)
-+DO_LD2(sve_ld2ss_r, cpu_ldl_data_ra, uint32_t, uint32_t, H1_4)
-+DO_LD3(sve_ld3ss_r, cpu_ldl_data_ra, uint32_t, uint32_t, H1_4)
-+DO_LD4(sve_ld4ss_r, cpu_ldl_data_ra, uint32_t, uint32_t, H1_4)
-+
-+DO_LD1(sve_ld1dd_r, cpu_ldq_data_ra, uint64_t, uint64_t, )
-+DO_LD2(sve_ld2dd_r, cpu_ldq_data_ra, uint64_t, uint64_t, )
-+DO_LD3(sve_ld3dd_r, cpu_ldq_data_ra, uint64_t, uint64_t, )
-+DO_LD4(sve_ld4dd_r, cpu_ldq_data_ra, uint64_t, uint64_t, )
-+
-+#undef DO_LD1
-+#undef DO_LD2
-+#undef DO_LD3
-+#undef DO_LD4
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
-+++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ typedef void gen_helper_gvec_flags_3(TCGv_i32, TCGv_ptr, TCGv_ptr,
- typedef void gen_helper_gvec_flags_4(TCGv_i32, TCGv_ptr, TCGv_ptr,
-                                      TCGv_ptr, TCGv_ptr, TCGv_i32);
-+typedef void gen_helper_gvec_mem(TCGv_env, TCGv_ptr, TCGv_i64, TCGv_i32);
-+
- /*
-  * Helpers for extracting complex instruction fields.
-  */
-@@ -XXX,XX +XXX,XX @@ static inline int expand_imm_sh8u(int x)
-     return (uint8_t)x << (x & 0x100 ? 8 : 0);
- }
-+/* Convert a 2-bit memory size (msz) to a 4-bit data type (dtype)
-+ * with unsigned data.  C.f. SVE Memory Contiguous Load Group.
-+ */
-+static inline int msz_dtype(int msz)
-+{
-+    static const uint8_t dtype[4] = { 0, 5, 10, 15 };
-+    return dtype[msz];
-+}
-+
- /*
-  * Include the generated decoder.
-  */
-@@ -XXX,XX +XXX,XX @@ static bool trans_LDR_pri(DisasContext *s, arg_rri *a, uint32_t insn)
-     }
-     return true;
- }
-+
-+/*
-+ *** SVE Memory - Contiguous Load Group
-+ */
-+
-+/* The memory mode of the dtype.  */
-+static const TCGMemOp dtype_mop[16] = {
-+    MO_UB, MO_UB, MO_UB, MO_UB,
-+    MO_SL, MO_UW, MO_UW, MO_UW,
-+    MO_SW, MO_SW, MO_UL, MO_UL,
-+    MO_SB, MO_SB, MO_SB, MO_Q
-+};
-+
-+#define dtype_msz(x)  (dtype_mop[x] & MO_SIZE)
-+
-+/* The vector element size of dtype.  */
-+static const uint8_t dtype_esz[16] = {
-+    0, 1, 2, 3,
-+    3, 1, 2, 3,
-+    3, 2, 2, 3,
-+    3, 2, 1, 3
-+};
-+
-+static void do_mem_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
-+                       gen_helper_gvec_mem *fn)
-+{
-+    unsigned vsz = vec_full_reg_size(s);
-+    TCGv_ptr t_pg;
-+    TCGv_i32 desc;
-+
-+    /* For e.g. LD4, there are not enough arguments to pass all 4
-+     * registers as pointers, so encode the regno into the data field.
-+     * For consistency, do this even for LD1.
-+     */
-+    desc = tcg_const_i32(simd_desc(vsz, vsz, zt));
-+    t_pg = tcg_temp_new_ptr();
-+
-+    tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, pg));
-+    fn(cpu_env, t_pg, addr, desc);
-+
-+    tcg_temp_free_ptr(t_pg);
-+    tcg_temp_free_i32(desc);
-+}
-+
-+static void do_ld_zpa(DisasContext *s, int zt, int pg,
-+                      TCGv_i64 addr, int dtype, int nreg)
-+{
-+    static gen_helper_gvec_mem * const fns[16][4] = {
-+        { gen_helper_sve_ld1bb_r, gen_helper_sve_ld2bb_r,
-+          gen_helper_sve_ld3bb_r, gen_helper_sve_ld4bb_r },
-+        { gen_helper_sve_ld1bhu_r, NULL, NULL, NULL },
-+        { gen_helper_sve_ld1bsu_r, NULL, NULL, NULL },
-+        { gen_helper_sve_ld1bdu_r, NULL, NULL, NULL },
-+
-+        { gen_helper_sve_ld1sds_r, NULL, NULL, NULL },
-+        { gen_helper_sve_ld1hh_r, gen_helper_sve_ld2hh_r,
-+          gen_helper_sve_ld3hh_r, gen_helper_sve_ld4hh_r },
-+        { gen_helper_sve_ld1hsu_r, NULL, NULL, NULL },
-+        { gen_helper_sve_ld1hdu_r, NULL, NULL, NULL },
-+
-+        { gen_helper_sve_ld1hds_r, NULL, NULL, NULL },
-+        { gen_helper_sve_ld1hss_r, NULL, NULL, NULL },
-+        { gen_helper_sve_ld1ss_r, gen_helper_sve_ld2ss_r,
-+          gen_helper_sve_ld3ss_r, gen_helper_sve_ld4ss_r },
-+        { gen_helper_sve_ld1sdu_r, NULL, NULL, NULL },
-+
-+        { gen_helper_sve_ld1bds_r, NULL, NULL, NULL },
-+        { gen_helper_sve_ld1bss_r, NULL, NULL, NULL },
-+        { gen_helper_sve_ld1bhs_r, NULL, NULL, NULL },
-+        { gen_helper_sve_ld1dd_r, gen_helper_sve_ld2dd_r,
-+          gen_helper_sve_ld3dd_r, gen_helper_sve_ld4dd_r },
-+    };
-+    gen_helper_gvec_mem *fn = fns[dtype][nreg];
-+
-+    /* While there are holes in the table, they are not
-+     * accessible via the instruction encoding.
-+     */
-+    assert(fn != NULL);
-+    do_mem_zpa(s, zt, pg, addr, fn);
-+}
-+
-+static bool trans_LD_zprr(DisasContext *s, arg_rprr_load *a, uint32_t insn)
-+{
-+    if (a->rm == 31) {
-+        return false;
-+    }
-+    if (sve_access_check(s)) {
-+        TCGv_i64 addr = new_tmp_a64(s);
-+        tcg_gen_muli_i64(addr, cpu_reg(s, a->rm),
-+                         (a->nreg + 1) << dtype_msz(a->dtype));
-+        tcg_gen_add_i64(addr, addr, cpu_reg_sp(s, a->rn));
-+        do_ld_zpa(s, a->rd, a->pg, addr, a->dtype, a->nreg);
-+    }
-+    return true;
-+}
-+
-+static bool trans_LD_zpri(DisasContext *s, arg_rpri_load *a, uint32_t insn)
-+{
-+    if (sve_access_check(s)) {
-+        int vsz = vec_full_reg_size(s);
-+        int elements = vsz >> dtype_esz[a->dtype];
-+        TCGv_i64 addr = new_tmp_a64(s);
-+
-+        tcg_gen_addi_i64(addr, cpu_reg_sp(s, a->rn),
-+                         (a->imm * elements * (a->nreg + 1))
-+                         << dtype_msz(a->dtype));
-+        do_ld_zpa(s, a->rd, a->pg, addr, a->dtype, a->nreg);
-+    }
-+    return true;
-+}
-diff --git a/target/arm/sve.decode b/target/arm/sve.decode
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
-+++ b/target/arm/sve.decode
-@@ -XXX,XX +XXX,XX @@
- # Unsigned 8-bit immediate, optionally shifted left by 8.
- %sh8_i8u        5:9 !function=expand_imm_sh8u
-+# Unsigned load of msz into esz=2, represented as a dtype.
-+%msz_dtype      23:2 !function=msz_dtype
-+
- # Either a copy of rd (at bit 0), or a different source
- # as propagated via the MOVPRFX instruction.
- %reg_movprfx    0:5
-@@ -XXX,XX +XXX,XX @@
- &incdec2_cnt    rd rn pat esz imm d u
- &incdec_pred    rd pg esz d u
- &incdec2_pred   rd rn pg esz d u
-+&rprr_load      rd pg rn rm dtype nreg
-+&rpri_load      rd pg rn imm dtype nreg
- ###########################################################################
- # Named instruction formats.  These are generally used to
-@@ -XXX,XX +XXX,XX @@
- @incdec2_pred   ........ esz:2 .... .. ..... .. pg:4 rd:5 \
-                 &incdec2_pred rn=%reg_movprfx
-+# Loads; user must fill in NREG.
-+@rprr_load_dt   ....... dtype:4 rm:5 ... pg:3 rn:5 rd:5         &rprr_load
-+@rpri_load_dt   ....... dtype:4 . imm:s4 ... pg:3 rn:5 rd:5     &rpri_load
-+
-+@rprr_load_msz  ....... .... rm:5 ... pg:3 rn:5 rd:5 \
-+                &rprr_load dtype=%msz_dtype
-+@rpri_load_msz  ....... .... . imm:s4 ... pg:3 rn:5 rd:5 \
-+                &rpri_load dtype=%msz_dtype
-+
- ###########################################################################
- # Instruction patterns.  Grouped according to the SVE encodingindex.xhtml.
-@@ -XXX,XX +XXX,XX @@ LDR_pri         10000101 10 ...... 000 ... ..... 0 ....         @pd_rn_i9
- # SVE load vector register
- LDR_zri         10000101 10 ...... 010 ... ..... .....          @rd_rn_i9
-+
-+### SVE Memory Contiguous Load Group
-+
-+# SVE contiguous load (scalar plus scalar)
-+LD_zprr         1010010 .... ..... 010 ... ..... .....    @rprr_load_dt nreg=0
-+
-+# SVE contiguous load (scalar plus immediate)
-+LD_zpri         1010010 .... 0.... 101 ... ..... .....    @rpri_load_dt nreg=0
-+
-+# SVE contiguous non-temporal load (scalar plus scalar)
-+# LDNT1B, LDNT1H, LDNT1W, LDNT1D
-+# SVE load multiple structures (scalar plus scalar)
-+# LD2B, LD2H, LD2W, LD2D; etc.
-+LD_zprr         1010010 .. nreg:2 ..... 110 ... ..... .....     @rprr_load_msz
-+
-+# SVE contiguous non-temporal load (scalar plus immediate)
-+# LDNT1B, LDNT1H, LDNT1W, LDNT1D
-+# SVE load multiple structures (scalar plus immediate)
-+# LD2B, LD2H, LD2W, LD2D; etc.
-+LD_zpri         1010010 .. nreg:2 0.... 111 ... ..... .....     @rpri_load_msz
---
-.17.1

-[Qemu-devel] [PULL 34/55] target/arm: Implement SVE floating-point complex add
+[Qemu-devel] [PULL 25/42] target/arm: Add lazy-FP-stacking support to v7m_stack_write()
-From: Richard Henderson <richard.henderson@linaro.org>
+Pushing registers to the stack for v7M needs to handle three cases:
+ * the "normal" case where we pend exceptions
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+ * an "ignore faults" case where we set FSR bits but
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+   do not pend exceptions (this is used when we are
-Message-id: 20180627043328.11531-29-richard.henderson@linaro.org
+   handling some kinds of derived exception on exception entry)
  * a "lazy FP stacking" case, where different FSR bits
    are set and the exception is pended differently
 Implement this by changing the existing flag argument that
 tells us whether to ignore faults or not into an enum that
 specifies which of the 3 modes we should handle.
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-23-peter.maydell@linaro.org
 ---
- target/arm/helper-sve.h    |   7 +++
+ target/arm/helper.c | 118 +++++++++++++++++++++++++++++---------------
- target/arm/sve_helper.c    | 100 +++++++++++++++++++++++++++++++++++++
+file changed, 79 insertions(+), 39 deletions(-)
- target/arm/translate-sve.c |  24 +++++++++
- target/arm/sve.decode      |   4 ++
+diff --git a/target/arm/helper.c b/target/arm/helper.c
 files changed, 135 insertions(+)
 diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
+--- a/target/arm/helper.c
-+++ b/target/arm/helper-sve.h
++++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_6(sve_facgt_s, TCG_CALL_NO_RWG,
+@@ -XXX,XX +XXX,XX @@ static bool v7m_cpacr_pass(CPUARMState *env, bool is_secure, bool is_priv)
  DEF_HELPER_FLAGS_6(sve_facgt_d, TCG_CALL_NO_RWG,
                     void, ptr, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_6(sve_fcadd_h, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_6(sve_fcadd_s, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_6(sve_fcadd_d, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, ptr, i32)
 +
  DEF_HELPER_FLAGS_3(sve_fmla_zpzzz_h, TCG_CALL_NO_RWG, void, env, ptr, i32)
  DEF_HELPER_FLAGS_3(sve_fmla_zpzzz_s, TCG_CALL_NO_RWG, void, env, ptr, i32)
  DEF_HELPER_FLAGS_3(sve_fmla_zpzzz_d, TCG_CALL_NO_RWG, void, env, ptr, i32)
 diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve_helper.c
 +++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(sve_ftmad_d)(void *vd, void *vn, void *vm, void *vs, uint32_t desc)
      }
  }
 +/*
-+ * FP Complex Add
++ * What kind of stack write are we doing? This affects how exceptions
 + * generated during the stacking are treated.
 + */
++typedef enum StackingMode {
++    STACK_NORMAL,
++    STACK_IGNFAULTS,
++    STACK_LAZYFP,
++} StackingMode;
 +
-+void HELPER(sve_fcadd_h)(void *vd, void *vn, void *vm, void *vg,
+ static bool v7m_stack_write(ARMCPU *cpu, uint32_t addr, uint32_t value,
-+                         void *vs, uint32_t desc)
+-                            ARMMMUIdx mmu_idx, bool ignfault)
-+{
++                            ARMMMUIdx mmu_idx, StackingMode mode)
-+    intptr_t j, i = simd_oprsz(desc);
+ {
-+    uint64_t *g = vg;
+     CPUState *cs = CPU(cpu);
-+    float16 neg_imag = float16_set_sign(0, simd_data(desc));
+     CPUARMState *env = &cpu->env;
-+    float16 neg_real = float16_chs(neg_imag);
+@@ -XXX,XX +XXX,XX @@ static bool v7m_stack_write(ARMCPU *cpu, uint32_t addr, uint32_t value,
-+
+                       &attrs, &prot, &page_size, &fi, NULL)) {
-+    do {
+         /* MPU/SAU lookup failed */
-+        uint64_t pg = g[(i - 1) >> 6];
+         if (fi.type == ARMFault_QEMU_SFault) {
-+        do {
+-            qemu_log_mask(CPU_LOG_INT,
-+            float16 e0, e1, e2, e3;
+-                          "...SecureFault with SFSR.AUVIOL during stacking\n");
-+
+-            env->v7m.sfsr |= R_V7M_SFSR_AUVIOL_MASK | R_V7M_SFSR_SFARVALID_MASK;
-+            /* I holds the real index; J holds the imag index.  */
++            if (mode == STACK_LAZYFP) {
-+            j = i - sizeof(float16);
++                qemu_log_mask(CPU_LOG_INT,
-+            i -= 2 * sizeof(float16);
++                              "...SecureFault with SFSR.LSPERR "
-+
++                              "during lazy stacking\n");
-+            e0 = *(float16 *)(vn + H1_2(i));
++                env->v7m.sfsr |= R_V7M_SFSR_LSPERR_MASK;
-+            e1 = *(float16 *)(vm + H1_2(j)) ^ neg_real;
++            } else {
-+            e2 = *(float16 *)(vn + H1_2(j));
++                qemu_log_mask(CPU_LOG_INT,
-+            e3 = *(float16 *)(vm + H1_2(i)) ^ neg_imag;
++                              "...SecureFault with SFSR.AUVIOL "
-+
++                              "during stacking\n");
-+            if (likely((pg >> (i & 63)) & 1)) {
++                env->v7m.sfsr |= R_V7M_SFSR_AUVIOL_MASK;
 +                *(float16 *)(vd + H1_2(i)) = float16_add(e0, e1, vs);
 +            }
-+            if (likely((pg >> (j & 63)) & 1)) {
++            env->v7m.sfsr |= R_V7M_SFSR_SFARVALID_MASK;
-+                *(float16 *)(vd + H1_2(j)) = float16_add(e2, e3, vs);
+             env->v7m.sfar = addr;
              exc = ARMV7M_EXCP_SECURE;
              exc_secure = false;
          } else {
 -            qemu_log_mask(CPU_LOG_INT, "...MemManageFault with CFSR.MSTKERR\n");
 -            env->v7m.cfsr[secure] |= R_V7M_CFSR_MSTKERR_MASK;
 +            if (mode == STACK_LAZYFP) {
 +                qemu_log_mask(CPU_LOG_INT,
 +                              "...MemManageFault with CFSR.MLSPERR\n");
 +                env->v7m.cfsr[secure] |= R_V7M_CFSR_MLSPERR_MASK;
 +            } else {
 +                qemu_log_mask(CPU_LOG_INT,
 +                              "...MemManageFault with CFSR.MSTKERR\n");
 +                env->v7m.cfsr[secure] |= R_V7M_CFSR_MSTKERR_MASK;
 +            }
-+        } while (i & 63);
+             exc = ARMV7M_EXCP_MEM;
-+    } while (i != 0);
+             exc_secure = secure;
-+}
+         }
-+
+@@ -XXX,XX +XXX,XX @@ static bool v7m_stack_write(ARMCPU *cpu, uint32_t addr, uint32_t value,
-+void HELPER(sve_fcadd_s)(void *vd, void *vn, void *vm, void *vg,
+                          attrs, &txres);
-+                         void *vs, uint32_t desc)
+     if (txres != MEMTX_OK) {
-+{
+         /* BusFault trying to write the data */
-+    intptr_t j, i = simd_oprsz(desc);
+-        qemu_log_mask(CPU_LOG_INT, "...BusFault with BFSR.STKERR\n");
-+    uint64_t *g = vg;
+-        env->v7m.cfsr[M_REG_NS] |= R_V7M_CFSR_STKERR_MASK;
-+    float32 neg_imag = float32_set_sign(0, simd_data(desc));
++        if (mode == STACK_LAZYFP) {
-+    float32 neg_real = float32_chs(neg_imag);
++            qemu_log_mask(CPU_LOG_INT, "...BusFault with BFSR.LSPERR\n");
-+
++            env->v7m.cfsr[M_REG_NS] |= R_V7M_CFSR_LSPERR_MASK;
-+    do {
++        } else {
-+        uint64_t pg = g[(i - 1) >> 6];
++            qemu_log_mask(CPU_LOG_INT, "...BusFault with BFSR.STKERR\n");
-+        do {
++            env->v7m.cfsr[M_REG_NS] |= R_V7M_CFSR_STKERR_MASK;
-+            float32 e0, e1, e2, e3;
++        }
-+
+         exc = ARMV7M_EXCP_BUS;
-+            /* I holds the real index; J holds the imag index.  */
+         exc_secure = false;
-+            j = i - sizeof(float32);
+         goto pend_fault;
-+            i -= 2 * sizeof(float32);
+@@ -XXX,XX +XXX,XX @@ pend_fault:
-+
+      * later if we have two derived exceptions.
-+            e0 = *(float32 *)(vn + H1_2(i));
+      * The only case when we must not pend the exception but instead
-+            e1 = *(float32 *)(vm + H1_2(j)) ^ neg_real;
+      * throw it away is if we are doing the push of the callee registers
-+            e2 = *(float32 *)(vn + H1_2(j));
+-     * and we've already generated a derived exception. Even in this
-+            e3 = *(float32 *)(vm + H1_2(i)) ^ neg_imag;
+-     * case we will still update the fault status registers.
-+
++     * and we've already generated a derived exception (this is indicated
-+            if (likely((pg >> (i & 63)) & 1)) {
++     * by the caller passing STACK_IGNFAULTS). Even in this case we will
-+                *(float32 *)(vd + H1_2(i)) = float32_add(e0, e1, vs);
++     * still update the fault status registers.
-+            }
+      */
-+            if (likely((pg >> (j & 63)) & 1)) {
+-    if (!ignfault) {
-+                *(float32 *)(vd + H1_2(j)) = float32_add(e2, e3, vs);
++    switch (mode) {
-+            }
++    case STACK_NORMAL:
-+        } while (i & 63);
+         armv7m_nvic_set_pending_derived(env->nvic, exc, exc_secure);
-+    } while (i != 0);
++        break;
-+}
++    case STACK_LAZYFP:
-+
++        armv7m_nvic_set_pending_lazyfp(env->nvic, exc, exc_secure);
-+void HELPER(sve_fcadd_d)(void *vd, void *vn, void *vm, void *vg,
++        break;
-+                         void *vs, uint32_t desc)
++    case STACK_IGNFAULTS:
-+{
++        break;
-+    intptr_t j, i = simd_oprsz(desc);
+     }
-+    uint64_t *g = vg;
+     return false;
-+    float64 neg_imag = float64_set_sign(0, simd_data(desc));
+ }
-+    float64 neg_real = float64_chs(neg_imag);
+@@ -XXX,XX +XXX,XX @@ static bool v7m_push_callee_stack(ARMCPU *cpu, uint32_t lr, bool dotailchain,
-+
+     uint32_t limit;
-+    do {
+     bool want_psp;
-+        uint64_t pg = g[(i - 1) >> 6];
+     uint32_t sig;
-+        do {
++    StackingMode smode = ignore_faults ? STACK_IGNFAULTS : STACK_NORMAL;
-+            float64 e0, e1, e2, e3;
-+
+     if (dotailchain) {
-+            /* I holds the real index; J holds the imag index.  */
+         bool mode = lr & R_V7M_EXCRET_MODE_MASK;
-+            j = i - sizeof(float64);
+@@ -XXX,XX +XXX,XX @@ static bool v7m_push_callee_stack(ARMCPU *cpu, uint32_t lr, bool dotailchain,
-+            i -= 2 * sizeof(float64);
+      */
-+
+     sig = v7m_integrity_sig(env, lr);
-+            e0 = *(float64 *)(vn + H1_2(i));
+     stacked_ok =
-+            e1 = *(float64 *)(vm + H1_2(j)) ^ neg_real;
+-        v7m_stack_write(cpu, frameptr, sig, mmu_idx, ignore_faults) &&
-+            e2 = *(float64 *)(vn + H1_2(j));
+-        v7m_stack_write(cpu, frameptr + 0x8, env->regs[4], mmu_idx,
-+            e3 = *(float64 *)(vm + H1_2(i)) ^ neg_imag;
+-                        ignore_faults) &&
-+
+-        v7m_stack_write(cpu, frameptr + 0xc, env->regs[5], mmu_idx,
-+            if (likely((pg >> (i & 63)) & 1)) {
+-                        ignore_faults) &&
-+                *(float64 *)(vd + H1_2(i)) = float64_add(e0, e1, vs);
+-        v7m_stack_write(cpu, frameptr + 0x10, env->regs[6], mmu_idx,
-+            }
+-                        ignore_faults) &&
-+            if (likely((pg >> (j & 63)) & 1)) {
+-        v7m_stack_write(cpu, frameptr + 0x14, env->regs[7], mmu_idx,
-+                *(float64 *)(vd + H1_2(j)) = float64_add(e2, e3, vs);
+-                        ignore_faults) &&
-+            }
+-        v7m_stack_write(cpu, frameptr + 0x18, env->regs[8], mmu_idx,
-+        } while (i & 63);
+-                        ignore_faults) &&
-+    } while (i != 0);
+-        v7m_stack_write(cpu, frameptr + 0x1c, env->regs[9], mmu_idx,
-+}
+-                        ignore_faults) &&
-+
+-        v7m_stack_write(cpu, frameptr + 0x20, env->regs[10], mmu_idx,
- /*
+-                        ignore_faults) &&
-  * Load contiguous data, protected by a governing predicate.
+-        v7m_stack_write(cpu, frameptr + 0x24, env->regs[11], mmu_idx,
-  */
+-                        ignore_faults);
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
++        v7m_stack_write(cpu, frameptr, sig, mmu_idx, smode) &&
-index XXXXXXX..XXXXXXX 100644
++        v7m_stack_write(cpu, frameptr + 0x8, env->regs[4], mmu_idx, smode) &&
---- a/target/arm/translate-sve.c
++        v7m_stack_write(cpu, frameptr + 0xc, env->regs[5], mmu_idx, smode) &&
-+++ b/target/arm/translate-sve.c
++        v7m_stack_write(cpu, frameptr + 0x10, env->regs[6], mmu_idx, smode) &&
-@@ -XXX,XX +XXX,XX @@ DO_FPCMP(FACGT, facgt)
++        v7m_stack_write(cpu, frameptr + 0x14, env->regs[7], mmu_idx, smode) &&
++        v7m_stack_write(cpu, frameptr + 0x18, env->regs[8], mmu_idx, smode) &&
- #undef DO_FPCMP
++        v7m_stack_write(cpu, frameptr + 0x1c, env->regs[9], mmu_idx, smode) &&
++        v7m_stack_write(cpu, frameptr + 0x20, env->regs[10], mmu_idx, smode) &&
-+static bool trans_FCADD(DisasContext *s, arg_FCADD *a, uint32_t insn)
++        v7m_stack_write(cpu, frameptr + 0x24, env->regs[11], mmu_idx, smode);
-+{
-+    static gen_helper_gvec_4_ptr * const fns[3] = {
+     /* Update SP regardless of whether any of the stack accesses failed. */
-+        gen_helper_sve_fcadd_h,
+     *frame_sp_p = frameptr;
-+        gen_helper_sve_fcadd_s,
+@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
-+        gen_helper_sve_fcadd_d
+      * if it has higher priority).
-+    };
+      */
-+
+     stacked_ok = stacked_ok &&
-+    if (a->esz == 0) {
+-        v7m_stack_write(cpu, frameptr, env->regs[0], mmu_idx, false) &&
-+        return false;
+-        v7m_stack_write(cpu, frameptr + 4, env->regs[1], mmu_idx, false) &&
-+    }
+-        v7m_stack_write(cpu, frameptr + 8, env->regs[2], mmu_idx, false) &&
-+    if (sve_access_check(s)) {
+-        v7m_stack_write(cpu, frameptr + 12, env->regs[3], mmu_idx, false) &&
-+        unsigned vsz = vec_full_reg_size(s);
+-        v7m_stack_write(cpu, frameptr + 16, env->regs[12], mmu_idx, false) &&
-+        TCGv_ptr status = get_fpstatus_ptr(a->esz == MO_16);
+-        v7m_stack_write(cpu, frameptr + 20, env->regs[14], mmu_idx, false) &&
-+        tcg_gen_gvec_4_ptr(vec_full_reg_offset(s, a->rd),
+-        v7m_stack_write(cpu, frameptr + 24, env->regs[15], mmu_idx, false) &&
-+                           vec_full_reg_offset(s, a->rn),
+-        v7m_stack_write(cpu, frameptr + 28, xpsr, mmu_idx, false);
-+                           vec_full_reg_offset(s, a->rm),
++        v7m_stack_write(cpu, frameptr, env->regs[0], mmu_idx, STACK_NORMAL) &&
-+                           pred_full_reg_offset(s, a->pg),
++        v7m_stack_write(cpu, frameptr + 4, env->regs[1],
-+                           status, vsz, vsz, a->rot, fns[a->esz - 1]);
++                        mmu_idx, STACK_NORMAL) &&
-+        tcg_temp_free_ptr(status);
++        v7m_stack_write(cpu, frameptr + 8, env->regs[2],
-+    }
++                        mmu_idx, STACK_NORMAL) &&
-+    return true;
++        v7m_stack_write(cpu, frameptr + 12, env->regs[3],
-+}
++                        mmu_idx, STACK_NORMAL) &&
-+
++        v7m_stack_write(cpu, frameptr + 16, env->regs[12],
- typedef void gen_helper_sve_fmla(TCGv_env, TCGv_ptr, TCGv_i32);
++                        mmu_idx, STACK_NORMAL) &&
++        v7m_stack_write(cpu, frameptr + 20, env->regs[14],
- static bool do_fmla(DisasContext *s, arg_rprrr_esz *a, gen_helper_sve_fmla *fn)
++                        mmu_idx, STACK_NORMAL) &&
-diff --git a/target/arm/sve.decode b/target/arm/sve.decode
++        v7m_stack_write(cpu, frameptr + 24, env->regs[15],
-index XXXXXXX..XXXXXXX 100644
++                        mmu_idx, STACK_NORMAL) &&
---- a/target/arm/sve.decode
++        v7m_stack_write(cpu, frameptr + 28, xpsr, mmu_idx, STACK_NORMAL);
-+++ b/target/arm/sve.decode
-@@ -XXX,XX +XXX,XX @@ UMIN_zzi        00100101 .. 101 011 110 ........ .....          @rdn_i8u
+     if (env->v7m.control[M_REG_S] & R_V7M_CONTROL_FPCA_MASK) {
- # SVE integer multiply immediate (unpredicated)
+         /* FPU is active, try to save its registers */
- MUL_zzi         00100101 .. 110 000 110 ........ .....          @rdn_i8s
+@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
+                         faddr += 8; /* skip the slot for the FPSCR */
-+# SVE floating-point complex add (predicated)
+                     }
-+FCADD           01100100 esz:2 00000 rot:1 100 pg:3 rm:5 rd:5 \
+                     stacked_ok = stacked_ok &&
-+                rn=%reg_movprfx
+-                        v7m_stack_write(cpu, faddr, slo, mmu_idx, false) &&
-+
+-                        v7m_stack_write(cpu, faddr + 4, shi, mmu_idx, false);
- ### SVE FP Multiply-Add Indexed Group
++                        v7m_stack_write(cpu, faddr, slo,
++                                        mmu_idx, STACK_NORMAL) &&
- # SVE floating-point multiply-add (indexed)
++                        v7m_stack_write(cpu, faddr + 4, shi,
 +                                        mmu_idx, STACK_NORMAL);
                  }
                  stacked_ok = stacked_ok &&
                      v7m_stack_write(cpu, frameptr + 0x60,
 -                                    vfp_get_fpscr(env), mmu_idx, false);
 +                                    vfp_get_fpscr(env), mmu_idx, STACK_NORMAL);
                  if (cpacr_pass) {
                      for (i = 0; i < ((framesize == 0xa8) ? 32 : 16); i += 2) {
                          *aa32_vfp_dreg(env, i / 2) = 0;
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 39/55] target/arm: Implement SVE dot product (indexed)
+[Qemu-devel] [PULL 26/42] target/arm: Implement M-profile lazy FP state preservation
-From: Richard Henderson <richard.henderson@linaro.org>
+The M-profile architecture floating point system supports
+lazy FP state preservation, where FP registers are not
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+pushed to the stack when an exception occurs but are instead
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+only saved if and when the first FP instruction in the exception
-Reviewed-by: Alex Bennée <alex.bennee@linaro.org>
+handler is executed. Implement this in QEMU, corresponding
-Message-id: 20180627043328.11531-34-richard.henderson@linaro.org
+to the check of LSPACT in the pseudocode ExecuteFPCheck().
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-24-peter.maydell@linaro.org
 ---
- target/arm/helper.h        |   5 ++
+ target/arm/cpu.h       |   3 ++
- target/arm/translate-sve.c |  18 ++++++
+ target/arm/helper.h    |   2 +
- target/arm/vec_helper.c    | 124 +++++++++++++++++++++++++++++++++++++
+ target/arm/translate.h |   1 +
- target/arm/sve.decode      |   6 ++
+ target/arm/helper.c    | 112 +++++++++++++++++++++++++++++++++++++++++
-files changed, 153 insertions(+)
+ target/arm/translate.c |  22 ++++++++
+files changed, 140 insertions(+)
 diff --git a/target/arm/cpu.h b/target/arm/cpu.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu.h
 +++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@
  #define EXCP_NOCP           17   /* v7M NOCP UsageFault */
  #define EXCP_INVSTATE       18   /* v7M INVSTATE UsageFault */
  #define EXCP_STKOF          19   /* v8M STKOF UsageFault */
 +#define EXCP_LAZYFP         20   /* v7M fault during lazy FP stacking */
  /* NB: add new EXCP_ defines to the array in arm_log_exception() too */
  #define ARMV7M_EXCP_RESET   1
@@ -XXX,XX +XXX,XX @@ FIELD(TBFLAG_A32, NS, 6, 1)
  FIELD(TBFLAG_A32, VFPEN, 7, 1)
  FIELD(TBFLAG_A32, CONDEXEC, 8, 8)
  FIELD(TBFLAG_A32, SCTLR_B, 16, 1)
 +/* For M profile only, set if FPCCR.LSPACT is set */
 +FIELD(TBFLAG_A32, LSPACT, 18, 1)
  /* For M profile only, set if we must create a new FP context */
  FIELD(TBFLAG_A32, NEW_FP_CTXT_NEEDED, 19, 1)
  /* For M profile only, set if FPCCR.S does not match current security state */
 diff --git a/target/arm/helper.h b/target/arm/helper.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.h
 +++ b/target/arm/helper.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_4(gvec_udot_b, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
+@@ -XXX,XX +XXX,XX @@ DEF_HELPER_2(v7m_blxns, void, env, i32)
- DEF_HELPER_FLAGS_4(gvec_sdot_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
- DEF_HELPER_FLAGS_4(gvec_udot_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
+ DEF_HELPER_3(v7m_tt, i32, env, i32, i32)
-+DEF_HELPER_FLAGS_4(gvec_sdot_idx_b, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
++DEF_HELPER_1(v7m_preserve_fp_state, void, env)
-+DEF_HELPER_FLAGS_4(gvec_udot_idx_b, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
++
-+DEF_HELPER_FLAGS_4(gvec_sdot_idx_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
+ DEF_HELPER_2(v8m_stackcheck, void, env, i32)
-+DEF_HELPER_FLAGS_4(gvec_udot_idx_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
-+
+ DEF_HELPER_4(access_check_cp_reg, void, env, ptr, i32, i32)
- DEF_HELPER_FLAGS_5(gvec_fcaddh, TCG_CALL_NO_RWG,
+diff --git a/target/arm/translate.h b/target/arm/translate.h
-                    void, ptr, ptr, ptr, ptr, i32)
+index XXXXXXX..XXXXXXX 100644
- DEF_HELPER_FLAGS_5(gvec_fcadds, TCG_CALL_NO_RWG,
+--- a/target/arm/translate.h
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
++++ b/target/arm/translate.h
-index XXXXXXX..XXXXXXX 100644
+@@ -XXX,XX +XXX,XX @@ typedef struct DisasContext {
---- a/target/arm/translate-sve.c
+     bool v8m_stackcheck; /* true if we need to perform v8M stack limit checks */
-+++ b/target/arm/translate-sve.c
+     bool v8m_fpccr_s_wrong; /* true if v8M FPCCR.S != v8m_secure */
-@@ -XXX,XX +XXX,XX @@ static bool trans_DOT_zzz(DisasContext *s, arg_DOT_zzz *a, uint32_t insn)
+     bool v7m_new_fp_ctxt_needed; /* ASPEN set but no active FP context */
-     return true;
++    bool v7m_lspact; /* FPCCR.LSPACT set */
      /* Immediate value in AArch32 SVC insn; must be set if is_jmp == DISAS_SWI
       * so that top level loop can generate correct syndrome information.
       */
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_blxns)(CPUARMState *env, uint32_t dest)
      g_assert_not_reached();
  }
-+static bool trans_DOT_zzx(DisasContext *s, arg_DOT_zzx *a, uint32_t insn)
++void HELPER(v7m_preserve_fp_state)(CPUARMState *env)
 +{
-+    static gen_helper_gvec_3 * const fns[2][2] = {
++    /* translate.c should never generate calls here in user-only mode */
-+        { gen_helper_gvec_sdot_idx_b, gen_helper_gvec_sdot_idx_h },
++    g_assert_not_reached();
 +        { gen_helper_gvec_udot_idx_b, gen_helper_gvec_udot_idx_h }
 +    };
 +
 +    if (sve_access_check(s)) {
 +        unsigned vsz = vec_full_reg_size(s);
 +        tcg_gen_gvec_3_ool(vec_full_reg_offset(s, a->rd),
 +                           vec_full_reg_offset(s, a->rn),
 +                           vec_full_reg_offset(s, a->rm),
 +                           vsz, vsz, a->index, fns[a->u][a->sz]);
 +    }
 +    return true;
 +}
 +
-+
+ uint32_t HELPER(v7m_tt)(CPUARMState *env, uint32_t addr, uint32_t op)
- /*
+ {
-  *** SVE Floating Point Multiply-Add Indexed Group
+     /* The TT instructions can be used by unprivileged code, but in
-  */
+@@ -XXX,XX +XXX,XX @@ pend_fault:
-diff --git a/target/arm/vec_helper.c b/target/arm/vec_helper.c
+     return false;
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/vec_helper.c
 +++ b/target/arm/vec_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(gvec_udot_h)(void *vd, void *vn, void *vm, uint32_t desc)
      clear_tail(d, opr_sz, simd_maxsz(desc));
  }
-+void HELPER(gvec_sdot_idx_b)(void *vd, void *vn, void *vm, uint32_t desc)
++void HELPER(v7m_preserve_fp_state)(CPUARMState *env)
 +{
-+    intptr_t i, segend, opr_sz = simd_oprsz(desc), opr_sz_4 = opr_sz / 4;
++    /*
-+    intptr_t index = simd_data(desc);
++     * Preserve FP state (because LSPACT was set and we are about
-+    uint32_t *d = vd;
++     * to execute an FP instruction). This corresponds to the
-+    int8_t *n = vn;
++     * PreserveFPState() pseudocode.
-+    int8_t *m_indexed = (int8_t *)vm + index * 4;
++     * We may throw an exception if the stacking fails.
 +
 +    /* Notice the special case of opr_sz == 8, from aa64/aa32 advsimd.
 +     * Otherwise opr_sz is a multiple of 16.
 +     */
-+    segend = MIN(4, opr_sz_4);
++    ARMCPU *cpu = arm_env_get_cpu(env);
-+    i = 0;
++    bool is_secure = env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_S_MASK;
-+    do {
++    bool negpri = !(env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_HFRDY_MASK);
-+        int8_t m0 = m_indexed[i * 4 + 0];
++    bool is_priv = !(env->v7m.fpccr[is_secure] & R_V7M_FPCCR_USER_MASK);
-+        int8_t m1 = m_indexed[i * 4 + 1];
++    bool splimviol = env->v7m.fpccr[is_secure] & R_V7M_FPCCR_SPLIMVIOL_MASK;
-+        int8_t m2 = m_indexed[i * 4 + 2];
++    uint32_t fpcar = env->v7m.fpcar[is_secure];
-+        int8_t m3 = m_indexed[i * 4 + 3];
++    bool stacked_ok = true;
-+
++    bool ts = is_secure && (env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_TS_MASK);
-+        do {
++    bool take_exception;
-+            d[i] += n[i * 4 + 0] * m0
++
-+                  + n[i * 4 + 1] * m1
++    /* Take the iothread lock as we are going to touch the NVIC */
-+                  + n[i * 4 + 2] * m2
++    qemu_mutex_lock_iothread();
-+                  + n[i * 4 + 3] * m3;
++
-+        } while (++i < segend);
++    /* Check the background context had access to the FPU */
-+        segend = i + 4;
++    if (!v7m_cpacr_pass(env, is_secure, is_priv)) {
-+    } while (i < opr_sz_4);
++        armv7m_nvic_set_pending_lazyfp(env->nvic, ARMV7M_EXCP_USAGE, is_secure);
-+
++        env->v7m.cfsr[is_secure] |= R_V7M_CFSR_NOCP_MASK;
-+    clear_tail(d, opr_sz, simd_maxsz(desc));
++        stacked_ok = false;
 +    } else if (!is_secure && !extract32(env->v7m.nsacr, 10, 1)) {
 +        armv7m_nvic_set_pending_lazyfp(env->nvic, ARMV7M_EXCP_USAGE, M_REG_S);
 +        env->v7m.cfsr[M_REG_S] |= R_V7M_CFSR_NOCP_MASK;
 +        stacked_ok = false;
 +    }
 +
 +    if (!splimviol && stacked_ok) {
 +        /* We only stack if the stack limit wasn't violated */
 +        int i;
 +        ARMMMUIdx mmu_idx;
 +
 +        mmu_idx = arm_v7m_mmu_idx_all(env, is_secure, is_priv, negpri);
 +        for (i = 0; i < (ts ? 32 : 16); i += 2) {
 +            uint64_t dn = *aa32_vfp_dreg(env, i / 2);
 +            uint32_t faddr = fpcar + 4 * i;
 +            uint32_t slo = extract64(dn, 0, 32);
 +            uint32_t shi = extract64(dn, 32, 32);
 +
 +            if (i >= 16) {
 +                faddr += 8; /* skip the slot for the FPSCR */
 +            }
 +            stacked_ok = stacked_ok &&
 +                v7m_stack_write(cpu, faddr, slo, mmu_idx, STACK_LAZYFP) &&
 +                v7m_stack_write(cpu, faddr + 4, shi, mmu_idx, STACK_LAZYFP);
 +        }
 +
 +        stacked_ok = stacked_ok &&
 +            v7m_stack_write(cpu, fpcar + 0x40,
 +                            vfp_get_fpscr(env), mmu_idx, STACK_LAZYFP);
 +    }
 +
 +    /*
 +     * We definitely pended an exception, but it's possible that it
 +     * might not be able to be taken now. If its priority permits us
 +     * to take it now, then we must not update the LSPACT or FP regs,
 +     * but instead jump out to take the exception immediately.
 +     * If it's just pending and won't be taken until the current
 +     * handler exits, then we do update LSPACT and the FP regs.
 +     */
 +    take_exception = !stacked_ok &&
 +        armv7m_nvic_can_take_pending_exception(env->nvic);
 +
 +    qemu_mutex_unlock_iothread();
 +
 +    if (take_exception) {
 +        raise_exception_ra(env, EXCP_LAZYFP, 0, 1, GETPC());
 +    }
 +
 +    env->v7m.fpccr[is_secure] &= ~R_V7M_FPCCR_LSPACT_MASK;
 +
 +    if (ts) {
 +        /* Clear s0 to s31 and the FPSCR */
 +        int i;
 +
 +        for (i = 0; i < 32; i += 2) {
 +            *aa32_vfp_dreg(env, i / 2) = 0;
 +        }
 +        vfp_set_fpscr(env, 0);
 +    }
 +    /*
 +     * Otherwise s0 to s15 and FPSCR are UNKNOWN; we choose to leave them
 +     * unchanged.
 +     */
 +}
 +
-+void HELPER(gvec_udot_idx_b)(void *vd, void *vn, void *vm, uint32_t desc)
+ /* Write to v7M CONTROL.SPSEL bit for the specified security bank.
-+{
+  * This may change the current stack pointer between Main and Process
-+    intptr_t i, segend, opr_sz = simd_oprsz(desc), opr_sz_4 = opr_sz / 4;
+  * stack pointers if it is done for the CONTROL register for the current
-+    intptr_t index = simd_data(desc);
+@@ -XXX,XX +XXX,XX @@ static void arm_log_exception(int idx)
-+    uint32_t *d = vd;
+             [EXCP_NOCP] = "v7M NOCP UsageFault",
-+    uint8_t *n = vn;
+             [EXCP_INVSTATE] = "v7M INVSTATE UsageFault",
-+    uint8_t *m_indexed = (uint8_t *)vm + index * 4;
+             [EXCP_STKOF] = "v8M STKOF UsageFault",
-+
++            [EXCP_LAZYFP] = "v7M exception during lazy FP stacking",
-+    /* Notice the special case of opr_sz == 8, from aa64/aa32 advsimd.
+         };
-+     * Otherwise opr_sz is a multiple of 16.
-+     */
+         if (idx >= 0 && idx < ARRAY_SIZE(excnames)) {
-+    segend = MIN(4, opr_sz_4);
+@@ -XXX,XX +XXX,XX @@ void arm_v7m_cpu_do_interrupt(CPUState *cs)
-+    i = 0;
+             return;
-+    do {
+         }
-+        uint8_t m0 = m_indexed[i * 4 + 0];
+         break;
-+        uint8_t m1 = m_indexed[i * 4 + 1];
++    case EXCP_LAZYFP:
-+        uint8_t m2 = m_indexed[i * 4 + 2];
++        /*
-+        uint8_t m3 = m_indexed[i * 4 + 3];
++         * We already pended the specific exception in the NVIC in the
-+
++         * v7m_preserve_fp_state() helper function.
-+        do {
++         */
-+            d[i] += n[i * 4 + 0] * m0
++        break;
-+                  + n[i * 4 + 1] * m1
+     default:
-+                  + n[i * 4 + 2] * m2
+         cpu_abort(cs, "Unhandled exception 0x%x\n", cs->exception_index);
-+                  + n[i * 4 + 3] * m3;
+         return; /* Never happens.  Keep compiler happy.  */
-+        } while (++i < segend);
+@@ -XXX,XX +XXX,XX @@ void cpu_get_tb_cpu_state(CPUARMState *env, target_ulong *pc,
-+        segend = i + 4;
+         flags = FIELD_DP32(flags, TBFLAG_A32, NEW_FP_CTXT_NEEDED, 1);
-+    } while (i < opr_sz_4);
+     }
-+
-+    clear_tail(d, opr_sz, simd_maxsz(desc));
++    if (arm_feature(env, ARM_FEATURE_M)) {
-+}
++        bool is_secure = env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_S_MASK;
 +
-+void HELPER(gvec_sdot_idx_h)(void *vd, void *vn, void *vm, uint32_t desc)
++        if (env->v7m.fpccr[is_secure] & R_V7M_FPCCR_LSPACT_MASK) {
-+{
++            flags = FIELD_DP32(flags, TBFLAG_A32, LSPACT, 1);
-+    intptr_t i, opr_sz = simd_oprsz(desc), opr_sz_8 = opr_sz / 8;
++        }
-+    intptr_t index = simd_data(desc);
++    }
-+    uint64_t *d = vd;
++
-+    int16_t *n = vn;
+     *pflags = flags;
-+    int16_t *m_indexed = (int16_t *)vm + index * 4;
+     *cs_base = 0;
-+
+ }
-+    /* This is supported by SVE only, so opr_sz is always a multiple of 16.
+diff --git a/target/arm/translate.c b/target/arm/translate.c
-+     * Process the entire segment all at once, writing back the results
+index XXXXXXX..XXXXXXX 100644
-+     * only after we've consumed all of the inputs.
+--- a/target/arm/translate.c
-+     */
++++ b/target/arm/translate.c
-+    for (i = 0; i < opr_sz_8 ; i += 2) {
+@@ -XXX,XX +XXX,XX @@ static int disas_vfp_insn(DisasContext *s, uint32_t insn)
-+        uint64_t d0, d1;
+     if (arm_dc_feature(s, ARM_FEATURE_M)) {
-+
+         /* Handle M-profile lazy FP state mechanics */
-+        d0  = n[i * 4 + 0] * (int64_t)m_indexed[i * 4 + 0];
-+        d0 += n[i * 4 + 1] * (int64_t)m_indexed[i * 4 + 1];
++        /* Trigger lazy-state preservation if necessary */
-+        d0 += n[i * 4 + 2] * (int64_t)m_indexed[i * 4 + 2];
++        if (s->v7m_lspact) {
-+        d0 += n[i * 4 + 3] * (int64_t)m_indexed[i * 4 + 3];
++            /*
-+        d1  = n[i * 4 + 4] * (int64_t)m_indexed[i * 4 + 0];
++             * Lazy state saving affects external memory and also the NVIC,
-+        d1 += n[i * 4 + 5] * (int64_t)m_indexed[i * 4 + 1];
++             * so we must mark it as an IO operation for icount.
-+        d1 += n[i * 4 + 6] * (int64_t)m_indexed[i * 4 + 2];
++             */
-+        d1 += n[i * 4 + 7] * (int64_t)m_indexed[i * 4 + 3];
++            if (tb_cflags(s->base.tb) & CF_USE_ICOUNT) {
-+
++                gen_io_start();
-+        d[i + 0] += d0;
++            }
-+        d[i + 1] += d1;
++            gen_helper_v7m_preserve_fp_state(cpu_env);
-+    }
++            if (tb_cflags(s->base.tb) & CF_USE_ICOUNT) {
-+
++                gen_io_end();
-+    clear_tail(d, opr_sz, simd_maxsz(desc));
++            }
-+}
++            /*
-+
++             * If the preserve_fp_state helper doesn't throw an exception
-+void HELPER(gvec_udot_idx_h)(void *vd, void *vn, void *vm, uint32_t desc)
++             * then it will clear LSPACT; we don't need to repeat this for
-+{
++             * any further FP insns in this TB.
-+    intptr_t i, opr_sz = simd_oprsz(desc), opr_sz_8 = opr_sz / 8;
++             */
-+    intptr_t index = simd_data(desc);
++            s->v7m_lspact = false;
-+    uint64_t *d = vd;
++        }
-+    uint16_t *n = vn;
++
-+    uint16_t *m_indexed = (uint16_t *)vm + index * 4;
+         /* Update ownership of FP context: set FPCCR.S to match current state */
-+
+         if (s->v8m_fpccr_s_wrong) {
-+    /* This is supported by SVE only, so opr_sz is always a multiple of 16.
+             TCGv_i32 tmp;
-+     * Process the entire segment all at once, writing back the results
+@@ -XXX,XX +XXX,XX @@ static void arm_tr_init_disas_context(DisasContextBase *dcbase, CPUState *cs)
-+     * only after we've consumed all of the inputs.
+     dc->v8m_fpccr_s_wrong = FIELD_EX32(tb_flags, TBFLAG_A32, FPCCR_S_WRONG);
-+     */
+     dc->v7m_new_fp_ctxt_needed =
-+    for (i = 0; i < opr_sz_8 ; i += 2) {
+         FIELD_EX32(tb_flags, TBFLAG_A32, NEW_FP_CTXT_NEEDED);
-+        uint64_t d0, d1;
++    dc->v7m_lspact = FIELD_EX32(tb_flags, TBFLAG_A32, LSPACT);
-+
+     dc->cp_regs = cpu->cp_regs;
-+        d0  = n[i * 4 + 0] * (uint64_t)m_indexed[i * 4 + 0];
+     dc->features = env->features;
-+        d0 += n[i * 4 + 1] * (uint64_t)m_indexed[i * 4 + 1];
 +        d0 += n[i * 4 + 2] * (uint64_t)m_indexed[i * 4 + 2];
 +        d0 += n[i * 4 + 3] * (uint64_t)m_indexed[i * 4 + 3];
 +        d1  = n[i * 4 + 4] * (uint64_t)m_indexed[i * 4 + 0];
 +        d1 += n[i * 4 + 5] * (uint64_t)m_indexed[i * 4 + 1];
 +        d1 += n[i * 4 + 6] * (uint64_t)m_indexed[i * 4 + 2];
 +        d1 += n[i * 4 + 7] * (uint64_t)m_indexed[i * 4 + 3];
 +
 +        d[i + 0] += d0;
 +        d[i + 1] += d1;
 +    }
 +
 +    clear_tail(d, opr_sz, simd_maxsz(desc));
 +}
 +
  void HELPER(gvec_fcaddh)(void *vd, void *vn, void *vm,
                           void *vfpst, uint32_t desc)
  {
 diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve.decode
 +++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@ MUL_zzi         00100101 .. 110 000 110 ........ .....          @rdn_i8s
  # SVE integer dot product (unpredicated)
  DOT_zzz         01000100 1 sz:1 0 rm:5 00000 u:1 rn:5 rd:5      ra=%reg_movprfx
 +# SVE integer dot product (indexed)
 +DOT_zzx         01000100 101 index:2 rm:3 00000 u:1 rn:5 rd:5 \
 +                sz=0 ra=%reg_movprfx
 +DOT_zzx         01000100 111 index:1 rm:4 00000 u:1 rn:5 rd:5 \
 +                sz=1 ra=%reg_movprfx
 +
  # SVE floating-point complex add (predicated)
  FCADD           01100100 esz:2 00000 rot:1 100 pg:3 rm:5 rd:5 \
                  rn=%reg_movprfx
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 30/55] target/arm: Implement SVE floating-point convert to integer
+[Qemu-devel] [PULL 27/42] target/arm: Implement VLSTM for v7M CPUs with an FPU
-From: Richard Henderson <richard.henderson@linaro.org>
+Implement the VLSTM instruction for v7M for the FPU present case.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20180627043328.11531-25-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-25-peter.maydell@linaro.org
 ---
- target/arm/helper-sve.h    | 30 +++++++++++++
+ target/arm/cpu.h       |  2 +
- target/arm/helper.h        | 12 +++---
+ target/arm/helper.h    |  2 +
- target/arm/helper.c        |  2 +-
+ target/arm/helper.c    | 84 ++++++++++++++++++++++++++++++++++++++++++
- target/arm/sve_helper.c    | 88 ++++++++++++++++++++++++++++++++++++++
+ target/arm/translate.c | 15 +++++++-
- target/arm/translate-sve.c | 70 ++++++++++++++++++++++++++++++
+files changed, 102 insertions(+), 1 deletion(-)
  target/arm/sve.decode      | 16 +++++++
 files changed, 211 insertions(+), 7 deletions(-)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
+diff --git a/target/arm/cpu.h b/target/arm/cpu.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
+--- a/target/arm/cpu.h
-+++ b/target/arm/helper-sve.h
++++ b/target/arm/cpu.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_5(sve_fcvt_hd, TCG_CALL_NO_RWG,
+@@ -XXX,XX +XXX,XX @@
- DEF_HELPER_FLAGS_5(sve_fcvt_sd, TCG_CALL_NO_RWG,
+ #define EXCP_INVSTATE       18   /* v7M INVSTATE UsageFault */
-                    void, ptr, ptr, ptr, ptr, i32)
+ #define EXCP_STKOF          19   /* v8M STKOF UsageFault */
+ #define EXCP_LAZYFP         20   /* v7M fault during lazy FP stacking */
-+DEF_HELPER_FLAGS_5(sve_fcvtzs_hh, TCG_CALL_NO_RWG,
++#define EXCP_LSERR          21   /* v8M LSERR SecureFault */
-+                   void, ptr, ptr, ptr, ptr, i32)
++#define EXCP_UNALIGNED      22   /* v7M UNALIGNED UsageFault */
-+DEF_HELPER_FLAGS_5(sve_fcvtzs_hs, TCG_CALL_NO_RWG,
+ /* NB: add new EXCP_ defines to the array in arm_log_exception() too */
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_fcvtzs_ss, TCG_CALL_NO_RWG,
+ #define ARMV7M_EXCP_RESET   1
 +                   void, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_5(sve_fcvtzs_ds, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_5(sve_fcvtzs_hd, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_5(sve_fcvtzs_sd, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_5(sve_fcvtzs_dd, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +
 +DEF_HELPER_FLAGS_5(sve_fcvtzu_hh, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_5(sve_fcvtzu_hs, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_5(sve_fcvtzu_ss, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_5(sve_fcvtzu_ds, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_5(sve_fcvtzu_hd, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_5(sve_fcvtzu_sd, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_5(sve_fcvtzu_dd, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +
  DEF_HELPER_FLAGS_5(sve_scvt_hh, TCG_CALL_NO_RWG,
                     void, ptr, ptr, ptr, ptr, i32)
  DEF_HELPER_FLAGS_5(sve_scvt_sh, TCG_CALL_NO_RWG,
 diff --git a/target/arm/helper.h b/target/arm/helper.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.h
 +++ b/target/arm/helper.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_2(vfp_touid, i32, f64, ptr)
+@@ -XXX,XX +XXX,XX @@ DEF_HELPER_3(v7m_tt, i32, env, i32, i32)
- DEF_HELPER_2(vfp_touizh, i32, f16, ptr)
- DEF_HELPER_2(vfp_touizs, i32, f32, ptr)
+ DEF_HELPER_1(v7m_preserve_fp_state, void, env)
- DEF_HELPER_2(vfp_touizd, i32, f64, ptr)
--DEF_HELPER_2(vfp_tosih, i32, f16, ptr)
++DEF_HELPER_2(v7m_vlstm, void, env, i32)
--DEF_HELPER_2(vfp_tosis, i32, f32, ptr)
++
--DEF_HELPER_2(vfp_tosid, i32, f64, ptr)
+ DEF_HELPER_2(v8m_stackcheck, void, env, i32)
--DEF_HELPER_2(vfp_tosizh, i32, f16, ptr)
--DEF_HELPER_2(vfp_tosizs, i32, f32, ptr)
+ DEF_HELPER_4(access_check_cp_reg, void, env, ptr, i32, i32)
 -DEF_HELPER_2(vfp_tosizd, i32, f64, ptr)
 +DEF_HELPER_2(vfp_tosih, s32, f16, ptr)
 +DEF_HELPER_2(vfp_tosis, s32, f32, ptr)
 +DEF_HELPER_2(vfp_tosid, s32, f64, ptr)
 +DEF_HELPER_2(vfp_tosizh, s32, f16, ptr)
 +DEF_HELPER_2(vfp_tosizs, s32, f32, ptr)
 +DEF_HELPER_2(vfp_tosizd, s32, f64, ptr)
  DEF_HELPER_3(vfp_toshs_round_to_zero, i32, f32, i32, ptr)
  DEF_HELPER_3(vfp_tosls_round_to_zero, i32, f32, i32, ptr)
 diff --git a/target/arm/helper.c b/target/arm/helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.c
 +++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ ftype HELPER(name)(uint32_t x, void *fpstp)                         \
+@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_preserve_fp_state)(CPUARMState *env)
      g_assert_not_reached();
  }
- #define CONV_FTOI(name, ftype, fsz, sign, round)                \
++void HELPER(v7m_vlstm)(CPUARMState *env, uint32_t fptr)
 -uint32_t HELPER(name)(ftype x, void *fpstp)                     \
 +sign##int32_t HELPER(name)(ftype x, void *fpstp)                \
  {                                                               \
      float_status *fpst = fpstp;                                 \
      if (float##fsz##_is_any_nan(x)) {                           \
 diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve_helper.c
 +++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ static inline float16 sve_f64_to_f16(float64 f, float_status *fpst)
      return ret;
  }
 +static inline int16_t vfp_float16_to_int16_rtz(float16 f, float_status *s)
 +{
-+    if (float16_is_any_nan(f)) {
++    /* translate.c should never generate calls here in user-only mode */
-+        float_raise(float_flag_invalid, s);
++    g_assert_not_reached();
 +        return 0;
 +    }
 +    return float16_to_int16_round_to_zero(f, s);
 +}
 +
-+static inline int64_t vfp_float16_to_int64_rtz(float16 f, float_status *s)
+ uint32_t HELPER(v7m_tt)(CPUARMState *env, uint32_t addr, uint32_t op)
  {
      /* The TT instructions can be used by unprivileged code, but in
@@ -XXX,XX +XXX,XX @@ static void v7m_update_fpccr(CPUARMState *env, uint32_t frameptr,
      }
  }
 +void HELPER(v7m_vlstm)(CPUARMState *env, uint32_t fptr)
 +{
-+    if (float16_is_any_nan(f)) {
++    /* fptr is the value of Rn, the frame pointer we store the FP regs to */
-+        float_raise(float_flag_invalid, s);
++    bool s = env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_S_MASK;
-+        return 0;
++    bool lspact = env->v7m.fpccr[s] & R_V7M_FPCCR_LSPACT_MASK;
 +
 +    assert(env->v7m.secure);
 +
 +    if (!(env->v7m.control[M_REG_S] & R_V7M_CONTROL_SFPA_MASK)) {
 +        return;
 +    }
-+    return float16_to_int64_round_to_zero(f, s);
++
 +    /* Check access to the coprocessor is permitted */
 +    if (!v7m_cpacr_pass(env, true, arm_current_el(env) != 0)) {
 +        raise_exception_ra(env, EXCP_NOCP, 0, 1, GETPC());
 +    }
 +
 +    if (lspact) {
 +        /* LSPACT should not be active when there is active FP state */
 +        raise_exception_ra(env, EXCP_LSERR, 0, 1, GETPC());
 +    }
 +
 +    if (fptr & 7) {
 +        raise_exception_ra(env, EXCP_UNALIGNED, 0, 1, GETPC());
 +    }
 +
 +    /*
 +     * Note that we do not use v7m_stack_write() here, because the
 +     * accesses should not set the FSR bits for stacking errors if they
 +     * fail. (In pseudocode terms, they are AccType_NORMAL, not AccType_STACK
 +     * or AccType_LAZYFP). Faults in cpu_stl_data() will throw exceptions
 +     * and longjmp out.
 +     */
 +    if (!(env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_LSPEN_MASK)) {
 +        bool ts = env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_TS_MASK;
 +        int i;
 +
 +        for (i = 0; i < (ts ? 32 : 16); i += 2) {
 +            uint64_t dn = *aa32_vfp_dreg(env, i / 2);
 +            uint32_t faddr = fptr + 4 * i;
 +            uint32_t slo = extract64(dn, 0, 32);
 +            uint32_t shi = extract64(dn, 32, 32);
 +
 +            if (i >= 16) {
 +                faddr += 8; /* skip the slot for the FPSCR */
 +            }
 +            cpu_stl_data(env, faddr, slo);
 +            cpu_stl_data(env, faddr + 4, shi);
 +        }
 +        cpu_stl_data(env, fptr + 0x40, vfp_get_fpscr(env));
 +
 +        /*
 +         * If TS is 0 then s0 to s15 and FPSCR are UNKNOWN; we choose to
 +         * leave them unchanged, matching our choice in v7m_preserve_fp_state.
 +         */
 +        if (ts) {
 +            for (i = 0; i < 32; i += 2) {
 +                *aa32_vfp_dreg(env, i / 2) = 0;
 +            }
 +            vfp_set_fpscr(env, 0);
 +        }
 +    } else {
 +        v7m_update_fpccr(env, fptr, false);
 +    }
 +
 +    env->v7m.control[M_REG_S] &= ~R_V7M_CONTROL_FPCA_MASK;
 +}
 +
-+static inline int64_t vfp_float32_to_int64_rtz(float32 f, float_status *s)
+ static bool v7m_push_stack(ARMCPU *cpu)
-+{
+ {
-+    if (float32_is_any_nan(f)) {
+     /* Do the "set up stack frame" part of exception entry,
-+        float_raise(float_flag_invalid, s);
+@@ -XXX,XX +XXX,XX @@ static void arm_log_exception(int idx)
-+        return 0;
+             [EXCP_INVSTATE] = "v7M INVSTATE UsageFault",
-+    }
+             [EXCP_STKOF] = "v8M STKOF UsageFault",
-+    return float32_to_int64_round_to_zero(f, s);
+             [EXCP_LAZYFP] = "v7M exception during lazy FP stacking",
-+}
++            [EXCP_LSERR] = "v8M LSERR UsageFault",
 +            [EXCP_UNALIGNED] = "v7M UNALIGNED UsageFault",
          };
          if (idx >= 0 && idx < ARRAY_SIZE(excnames)) {
@@ -XXX,XX +XXX,XX @@ void arm_v7m_cpu_do_interrupt(CPUState *cs)
          armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE, env->v7m.secure);
          env->v7m.cfsr[env->v7m.secure] |= R_V7M_CFSR_STKOF_MASK;
          break;
 +    case EXCP_LSERR:
 +        armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_SECURE, false);
 +        env->v7m.sfsr |= R_V7M_SFSR_LSERR_MASK;
 +        break;
 +    case EXCP_UNALIGNED:
 +        armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE, env->v7m.secure);
 +        env->v7m.cfsr[env->v7m.secure] |= R_V7M_CFSR_UNALIGNED_MASK;
 +        break;
      case EXCP_SWI:
          /* The PC already points to the next instruction.  */
          armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_SVC, env->v7m.secure);
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate.c
 +++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void disas_thumb2_insn(DisasContext *s, uint32_t insn)
                  if (!s->v8m_secure || (insn & 0x0040f0ff)) {
                      goto illegal_op;
                  }
 -                /* Just NOP since FP support is not implemented */
 +
-+static inline int64_t vfp_float64_to_int64_rtz(float64 f, float_status *s)
++                if (arm_dc_feature(s, ARM_FEATURE_VFP)) {
-+{
++                    TCGv_i32 fptr = load_reg(s, rn);
 +    if (float64_is_any_nan(f)) {
 +        float_raise(float_flag_invalid, s);
 +        return 0;
 +    }
 +    return float64_to_int64_round_to_zero(f, s);
 +}
 +
-+static inline uint16_t vfp_float16_to_uint16_rtz(float16 f, float_status *s)
++                    if (extract32(insn, 20, 1)) {
-+{
++                        /* VLLDM */
-+    if (float16_is_any_nan(f)) {
++                    } else {
-+        float_raise(float_flag_invalid, s);
++                        gen_helper_v7m_vlstm(cpu_env, fptr);
-+        return 0;
++                    }
-+    }
++                    tcg_temp_free_i32(fptr);
 +    return float16_to_uint16_round_to_zero(f, s);
 +}
 +
-+static inline uint64_t vfp_float16_to_uint64_rtz(float16 f, float_status *s)
++                    /* End the TB, because we have updated FP control bits */
-+{
++                    s->base.is_jmp = DISAS_UPDATE;
-+    if (float16_is_any_nan(f)) {
++                }
-+        float_raise(float_flag_invalid, s);
+                 break;
-+        return 0;
+             }
-+    }
+             if (arm_dc_feature(s, ARM_FEATURE_VFP) &&
 +    return float16_to_uint64_round_to_zero(f, s);
 +}
 +
 +static inline uint64_t vfp_float32_to_uint64_rtz(float32 f, float_status *s)
 +{
 +    if (float32_is_any_nan(f)) {
 +        float_raise(float_flag_invalid, s);
 +        return 0;
 +    }
 +    return float32_to_uint64_round_to_zero(f, s);
 +}
 +
 +static inline uint64_t vfp_float64_to_uint64_rtz(float64 f, float_status *s)
 +{
 +    if (float64_is_any_nan(f)) {
 +        float_raise(float_flag_invalid, s);
 +        return 0;
 +    }
 +    return float64_to_uint64_round_to_zero(f, s);
 +}
 +
  DO_ZPZ_FP(sve_fcvt_sh, uint32_t, H1_4, sve_f32_to_f16)
  DO_ZPZ_FP(sve_fcvt_hs, uint32_t, H1_4, sve_f16_to_f32)
  DO_ZPZ_FP(sve_fcvt_dh, uint64_t,     , sve_f64_to_f16)
@@ -XXX,XX +XXX,XX @@ DO_ZPZ_FP(sve_fcvt_hd, uint64_t,     , sve_f16_to_f64)
  DO_ZPZ_FP(sve_fcvt_ds, uint64_t,     , float64_to_float32)
  DO_ZPZ_FP(sve_fcvt_sd, uint64_t,     , float32_to_float64)
 +DO_ZPZ_FP(sve_fcvtzs_hh, uint16_t, H1_2, vfp_float16_to_int16_rtz)
 +DO_ZPZ_FP(sve_fcvtzs_hs, uint32_t, H1_4, helper_vfp_tosizh)
 +DO_ZPZ_FP(sve_fcvtzs_ss, uint32_t, H1_4, helper_vfp_tosizs)
 +DO_ZPZ_FP(sve_fcvtzs_hd, uint64_t,     , vfp_float16_to_int64_rtz)
 +DO_ZPZ_FP(sve_fcvtzs_sd, uint64_t,     , vfp_float32_to_int64_rtz)
 +DO_ZPZ_FP(sve_fcvtzs_ds, uint64_t,     , helper_vfp_tosizd)
 +DO_ZPZ_FP(sve_fcvtzs_dd, uint64_t,     , vfp_float64_to_int64_rtz)
 +
 +DO_ZPZ_FP(sve_fcvtzu_hh, uint16_t, H1_2, vfp_float16_to_uint16_rtz)
 +DO_ZPZ_FP(sve_fcvtzu_hs, uint32_t, H1_4, helper_vfp_touizh)
 +DO_ZPZ_FP(sve_fcvtzu_ss, uint32_t, H1_4, helper_vfp_touizs)
 +DO_ZPZ_FP(sve_fcvtzu_hd, uint64_t,     , vfp_float16_to_uint64_rtz)
 +DO_ZPZ_FP(sve_fcvtzu_sd, uint64_t,     , vfp_float32_to_uint64_rtz)
 +DO_ZPZ_FP(sve_fcvtzu_ds, uint64_t,     , helper_vfp_touizd)
 +DO_ZPZ_FP(sve_fcvtzu_dd, uint64_t,     , vfp_float64_to_uint64_rtz)
 +
  DO_ZPZ_FP(sve_scvt_hh, uint16_t, H1_2, int16_to_float16)
  DO_ZPZ_FP(sve_scvt_sh, uint32_t, H1_4, int32_to_float16)
  DO_ZPZ_FP(sve_scvt_ss, uint32_t, H1_4, int32_to_float32)
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-sve.c
 +++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_FCVT_sd(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
      return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvt_sd);
  }
 +static bool trans_FCVTZS_hh(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
 +{
 +    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzs_hh);
 +}
 +
 +static bool trans_FCVTZU_hh(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
 +{
 +    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzu_hh);
 +}
 +
 +static bool trans_FCVTZS_hs(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
 +{
 +    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzs_hs);
 +}
 +
 +static bool trans_FCVTZU_hs(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
 +{
 +    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzu_hs);
 +}
 +
 +static bool trans_FCVTZS_hd(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
 +{
 +    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzs_hd);
 +}
 +
 +static bool trans_FCVTZU_hd(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
 +{
 +    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvtzu_hd);
 +}
 +
 +static bool trans_FCVTZS_ss(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
 +{
 +    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzs_ss);
 +}
 +
 +static bool trans_FCVTZU_ss(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
 +{
 +    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzu_ss);
 +}
 +
 +static bool trans_FCVTZS_sd(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
 +{
 +    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzs_sd);
 +}
 +
 +static bool trans_FCVTZU_sd(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
 +{
 +    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzu_sd);
 +}
 +
 +static bool trans_FCVTZS_ds(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
 +{
 +    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzs_ds);
 +}
 +
 +static bool trans_FCVTZU_ds(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
 +{
 +    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzu_ds);
 +}
 +
 +static bool trans_FCVTZS_dd(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
 +{
 +    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzs_dd);
 +}
 +
 +static bool trans_FCVTZU_dd(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
 +{
 +    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzu_dd);
 +}
 +
  static bool trans_SCVTF_hh(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
  {
      return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_scvt_hh);
 diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve.decode
 +++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@ FCVT_hd         01100101 11 0010 01 101 ... ..... .....         @rd_pg_rn_e0
  FCVT_ds         01100101 11 0010 10 101 ... ..... .....         @rd_pg_rn_e0
  FCVT_sd         01100101 11 0010 11 101 ... ..... .....         @rd_pg_rn_e0
 +# SVE floating-point convert to integer
 +FCVTZS_hh       01100101 01 011 01 0 101 ... ..... .....        @rd_pg_rn_e0
 +FCVTZU_hh       01100101 01 011 01 1 101 ... ..... .....        @rd_pg_rn_e0
 +FCVTZS_hs       01100101 01 011 10 0 101 ... ..... .....        @rd_pg_rn_e0
 +FCVTZU_hs       01100101 01 011 10 1 101 ... ..... .....        @rd_pg_rn_e0
 +FCVTZS_hd       01100101 01 011 11 0 101 ... ..... .....        @rd_pg_rn_e0
 +FCVTZU_hd       01100101 01 011 11 1 101 ... ..... .....        @rd_pg_rn_e0
 +FCVTZS_ss       01100101 10 011 10 0 101 ... ..... .....        @rd_pg_rn_e0
 +FCVTZU_ss       01100101 10 011 10 1 101 ... ..... .....        @rd_pg_rn_e0
 +FCVTZS_ds       01100101 11 011 00 0 101 ... ..... .....        @rd_pg_rn_e0
 +FCVTZU_ds       01100101 11 011 00 1 101 ... ..... .....        @rd_pg_rn_e0
 +FCVTZS_sd       01100101 11 011 10 0 101 ... ..... .....        @rd_pg_rn_e0
 +FCVTZU_sd       01100101 11 011 10 1 101 ... ..... .....        @rd_pg_rn_e0
 +FCVTZS_dd       01100101 11 011 11 0 101 ... ..... .....        @rd_pg_rn_e0
 +FCVTZU_dd       01100101 11 011 11 1 101 ... ..... .....        @rd_pg_rn_e0
 +
  # SVE integer convert to floating-point
  SCVTF_hh        01100101 01 010 01 0 101 ... ..... .....        @rd_pg_rn_e0
  SCVTF_sh        01100101 01 010 10 0 101 ... ..... .....        @rd_pg_rn_e0
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 38/55] target/arm: Implement SVE dot product (vectors)
+[Qemu-devel] [PULL 28/42] target/arm: Implement VLLDM for v7M CPUs with an FPU
-From: Richard Henderson <richard.henderson@linaro.org>
+Implement the VLLDM instruction for v7M for the FPU present cas.
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20180627043328.11531-33-richard.henderson@linaro.org
-[PMM: moved 'ra=%reg_movprfx' here from following patch]
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-26-peter.maydell@linaro.org
 ---
- target/arm/helper.h        |  5 +++
+ target/arm/helper.h    |  1 +
- target/arm/translate-sve.c | 17 ++++++++++
+ target/arm/helper.c    | 54 ++++++++++++++++++++++++++++++++++++++++++
- target/arm/vec_helper.c    | 67 ++++++++++++++++++++++++++++++++++++++
+ target/arm/translate.c |  2 +-
- target/arm/sve.decode      |  3 ++
+files changed, 56 insertions(+), 1 deletion(-)
 files changed, 92 insertions(+)
 diff --git a/target/arm/helper.h b/target/arm/helper.h
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/helper.h
 +++ b/target/arm/helper.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_5(gvec_qrdmlah_s32, TCG_CALL_NO_RWG,
+@@ -XXX,XX +XXX,XX @@ DEF_HELPER_3(v7m_tt, i32, env, i32, i32)
- DEF_HELPER_FLAGS_5(gvec_qrdmlsh_s32, TCG_CALL_NO_RWG,
+ DEF_HELPER_1(v7m_preserve_fp_state, void, env)
-                    void, ptr, ptr, ptr, ptr, i32)
+ DEF_HELPER_2(v7m_vlstm, void, env, i32)
-+DEF_HELPER_FLAGS_4(gvec_sdot_b, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
++DEF_HELPER_2(v7m_vlldm, void, env, i32)
-+DEF_HELPER_FLAGS_4(gvec_udot_b, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_4(gvec_sdot_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
+ DEF_HELPER_2(v8m_stackcheck, void, env, i32)
-+DEF_HELPER_FLAGS_4(gvec_udot_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
-+
+diff --git a/target/arm/helper.c b/target/arm/helper.c
  DEF_HELPER_FLAGS_5(gvec_fcaddh, TCG_CALL_NO_RWG,
                     void, ptr, ptr, ptr, ptr, i32)
  DEF_HELPER_FLAGS_5(gvec_fcadds, TCG_CALL_NO_RWG,
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
+--- a/target/arm/helper.c
-+++ b/target/arm/translate-sve.c
++++ b/target/arm/helper.c
-@@ -XXX,XX +XXX,XX @@ DO_ZZI(UMIN, umin)
+@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_vlstm)(CPUARMState *env, uint32_t fptr)
+     g_assert_not_reached();
- #undef DO_ZZI
+ }
-+static bool trans_DOT_zzz(DisasContext *s, arg_DOT_zzz *a, uint32_t insn)
++void HELPER(v7m_vlldm)(CPUARMState *env, uint32_t fptr)
 +{
-+    static gen_helper_gvec_3 * const fns[2][2] = {
++    /* translate.c should never generate calls here in user-only mode */
-+        { gen_helper_gvec_sdot_b, gen_helper_gvec_sdot_h },
++    g_assert_not_reached();
 +        { gen_helper_gvec_udot_b, gen_helper_gvec_udot_h }
 +    };
 +
 +    if (sve_access_check(s)) {
 +        unsigned vsz = vec_full_reg_size(s);
 +        tcg_gen_gvec_3_ool(vec_full_reg_offset(s, a->rd),
 +                           vec_full_reg_offset(s, a->rn),
 +                           vec_full_reg_offset(s, a->rm),
 +                           vsz, vsz, 0, fns[a->u][a->sz]);
 +    }
 +    return true;
 +}
 +
- /*
+ uint32_t HELPER(v7m_tt)(CPUARMState *env, uint32_t addr, uint32_t op)
-  *** SVE Floating Point Multiply-Add Indexed Group
+ {
-  */
+     /* The TT instructions can be used by unprivileged code, but in
-diff --git a/target/arm/vec_helper.c b/target/arm/vec_helper.c
+@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_vlstm)(CPUARMState *env, uint32_t fptr)
-index XXXXXXX..XXXXXXX 100644
+     env->v7m.control[M_REG_S] &= ~R_V7M_CONTROL_FPCA_MASK;
 --- a/target/arm/vec_helper.c
 +++ b/target/arm/vec_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(gvec_qrdmlsh_s32)(void *vd, void *vn, void *vm,
      clear_tail(d, opr_sz, simd_maxsz(desc));
  }
-+/* Integer 8 and 16-bit dot-product.
++void HELPER(v7m_vlldm)(CPUARMState *env, uint32_t fptr)
-+ *
++{
-+ * Note that for the loops herein, host endianness does not matter
++    /* fptr is the value of Rn, the frame pointer we load the FP regs from */
-+ * with respect to the ordering of data within the 64-bit lanes.
++    assert(env->v7m.secure);
 + * All elements are treated equally, no matter where they are.
 + */
 +
-+void HELPER(gvec_sdot_b)(void *vd, void *vn, void *vm, uint32_t desc)
++    if (!(env->v7m.control[M_REG_S] & R_V7M_CONTROL_SFPA_MASK)) {
-+{
++        return;
-+    intptr_t i, opr_sz = simd_oprsz(desc);
++    }
 +    uint32_t *d = vd;
 +    int8_t *n = vn, *m = vm;
 +
-+    for (i = 0; i < opr_sz / 4; ++i) {
++    /* Check access to the coprocessor is permitted */
-+        d[i] += n[i * 4 + 0] * m[i * 4 + 0]
++    if (!v7m_cpacr_pass(env, true, arm_current_el(env) != 0)) {
-+              + n[i * 4 + 1] * m[i * 4 + 1]
++        raise_exception_ra(env, EXCP_NOCP, 0, 1, GETPC());
 +              + n[i * 4 + 2] * m[i * 4 + 2]
 +              + n[i * 4 + 3] * m[i * 4 + 3];
 +    }
-+    clear_tail(d, opr_sz, simd_maxsz(desc));
++
 +    if (env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_LSPACT_MASK) {
 +        /* State in FP is still valid */
 +        env->v7m.fpccr[M_REG_S] &= ~R_V7M_FPCCR_LSPACT_MASK;
 +    } else {
 +        bool ts = env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_TS_MASK;
 +        int i;
 +        uint32_t fpscr;
 +
 +        if (fptr & 7) {
 +            raise_exception_ra(env, EXCP_UNALIGNED, 0, 1, GETPC());
 +        }
 +
 +        for (i = 0; i < (ts ? 32 : 16); i += 2) {
 +            uint32_t slo, shi;
 +            uint64_t dn;
 +            uint32_t faddr = fptr + 4 * i;
 +
 +            if (i >= 16) {
 +                faddr += 8; /* skip the slot for the FPSCR */
 +            }
 +
 +            slo = cpu_ldl_data(env, faddr);
 +            shi = cpu_ldl_data(env, faddr + 4);
 +
 +            dn = (uint64_t) shi << 32 | slo;
 +            *aa32_vfp_dreg(env, i / 2) = dn;
 +        }
 +        fpscr = cpu_ldl_data(env, fptr + 0x40);
 +        vfp_set_fpscr(env, fpscr);
 +    }
 +
 +    env->v7m.control[M_REG_S] |= R_V7M_CONTROL_FPCA_MASK;
 +}
 +
-+void HELPER(gvec_udot_b)(void *vd, void *vn, void *vm, uint32_t desc)
+ static bool v7m_push_stack(ARMCPU *cpu)
 +{
 +    intptr_t i, opr_sz = simd_oprsz(desc);
 +    uint32_t *d = vd;
 +    uint8_t *n = vn, *m = vm;
 +
 +    for (i = 0; i < opr_sz / 4; ++i) {
 +        d[i] += n[i * 4 + 0] * m[i * 4 + 0]
 +              + n[i * 4 + 1] * m[i * 4 + 1]
 +              + n[i * 4 + 2] * m[i * 4 + 2]
 +              + n[i * 4 + 3] * m[i * 4 + 3];
 +    }
 +    clear_tail(d, opr_sz, simd_maxsz(desc));
 +}
 +
 +void HELPER(gvec_sdot_h)(void *vd, void *vn, void *vm, uint32_t desc)
 +{
 +    intptr_t i, opr_sz = simd_oprsz(desc);
 +    uint64_t *d = vd;
 +    int16_t *n = vn, *m = vm;
 +
 +    for (i = 0; i < opr_sz / 8; ++i) {
 +        d[i] += (int64_t)n[i * 4 + 0] * m[i * 4 + 0]
 +              + (int64_t)n[i * 4 + 1] * m[i * 4 + 1]
 +              + (int64_t)n[i * 4 + 2] * m[i * 4 + 2]
 +              + (int64_t)n[i * 4 + 3] * m[i * 4 + 3];
 +    }
 +    clear_tail(d, opr_sz, simd_maxsz(desc));
 +}
 +
 +void HELPER(gvec_udot_h)(void *vd, void *vn, void *vm, uint32_t desc)
 +{
 +    intptr_t i, opr_sz = simd_oprsz(desc);
 +    uint64_t *d = vd;
 +    uint16_t *n = vn, *m = vm;
 +
 +    for (i = 0; i < opr_sz / 8; ++i) {
 +        d[i] += (uint64_t)n[i * 4 + 0] * m[i * 4 + 0]
 +              + (uint64_t)n[i * 4 + 1] * m[i * 4 + 1]
 +              + (uint64_t)n[i * 4 + 2] * m[i * 4 + 2]
 +              + (uint64_t)n[i * 4 + 3] * m[i * 4 + 3];
 +    }
 +    clear_tail(d, opr_sz, simd_maxsz(desc));
 +}
 +
  void HELPER(gvec_fcaddh)(void *vd, void *vn, void *vm,
                           void *vfpst, uint32_t desc)
  {
-diff --git a/target/arm/sve.decode b/target/arm/sve.decode
+     /* Do the "set up stack frame" part of exception entry,
 diff --git a/target/arm/translate.c b/target/arm/translate.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
+--- a/target/arm/translate.c
-+++ b/target/arm/sve.decode
++++ b/target/arm/translate.c
-@@ -XXX,XX +XXX,XX @@ UMIN_zzi        00100101 .. 101 011 110 ........ .....          @rdn_i8u
+@@ -XXX,XX +XXX,XX @@ static void disas_thumb2_insn(DisasContext *s, uint32_t insn)
- # SVE integer multiply immediate (unpredicated)
+                     TCGv_i32 fptr = load_reg(s, rn);
- MUL_zzi         00100101 .. 110 000 110 ........ .....          @rdn_i8s
+                     if (extract32(insn, 20, 1)) {
-+# SVE integer dot product (unpredicated)
+-                        /* VLLDM */
-+DOT_zzz         01000100 1 sz:1 0 rm:5 00000 u:1 rn:5 rd:5      ra=%reg_movprfx
++                        gen_helper_v7m_vlldm(cpu_env, fptr);
-+
+                     } else {
- # SVE floating-point complex add (predicated)
+                         gen_helper_v7m_vlstm(cpu_env, fptr);
- FCADD           01100100 esz:2 00000 rot:1 100 pg:3 rm:5 rd:5 \
+                     }
                  rn=%reg_movprfx
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 54/55] target/arm: Prune a15 features from max
+[Qemu-devel] [PULL 29/42] target/arm: Enable FPU for Cortex-M4 and Cortex-M33
-From: Richard Henderson <richard.henderson@linaro.org>
+Enable the FPU by default for the Cortex-M4 and Cortex-M33.
-There is no need to re-set these 3 features already
-implied by the call to aarch64_a15_initfn.
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Message-id: 20180629001538.11415-5-richard.henderson@linaro.org
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
+Message-id: 20190416125744.27770-27-peter.maydell@linaro.org
 ---
- target/arm/cpu.c | 3 ---
+ target/arm/cpu.c | 8 ++++++++
-file changed, 3 deletions(-)
+file changed, 8 insertions(+)
 diff --git a/target/arm/cpu.c b/target/arm/cpu.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/cpu.c
 +++ b/target/arm/cpu.c
-@@ -XXX,XX +XXX,XX @@ static void arm_max_initfn(Object *obj)
+@@ -XXX,XX +XXX,XX @@ static void cortex_m4_initfn(Object *obj)
-          * since we don't correctly set the ID registers to advertise them,
+     set_feature(&cpu->env, ARM_FEATURE_M);
-          */
+     set_feature(&cpu->env, ARM_FEATURE_M_MAIN);
-         set_feature(&cpu->env, ARM_FEATURE_V8);
+     set_feature(&cpu->env, ARM_FEATURE_THUMB_DSP);
--        set_feature(&cpu->env, ARM_FEATURE_VFP4);
++    set_feature(&cpu->env, ARM_FEATURE_VFP4);
--        set_feature(&cpu->env, ARM_FEATURE_NEON);
+     cpu->midr = 0x410fc240; /* r0p0 */
--        set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
+     cpu->pmsav7_dregion = 8;
-         set_feature(&cpu->env, ARM_FEATURE_V8_AES);
++    cpu->isar.mvfr0 = 0x10110021;
-         set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
++    cpu->isar.mvfr1 = 0x11000011;
-         set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
++    cpu->isar.mvfr2 = 0x00000000;
      cpu->id_pfr0 = 0x00000030;
      cpu->id_pfr1 = 0x00000200;
      cpu->id_dfr0 = 0x00100000;
@@ -XXX,XX +XXX,XX @@ static void cortex_m33_initfn(Object *obj)
      set_feature(&cpu->env, ARM_FEATURE_M_MAIN);
      set_feature(&cpu->env, ARM_FEATURE_M_SECURITY);
      set_feature(&cpu->env, ARM_FEATURE_THUMB_DSP);
 +    set_feature(&cpu->env, ARM_FEATURE_VFP4);
      cpu->midr = 0x410fd213; /* r0p3 */
      cpu->pmsav7_dregion = 16;
      cpu->sau_sregion = 8;
 +    cpu->isar.mvfr0 = 0x10110021;
 +    cpu->isar.mvfr1 = 0x11000011;
 +    cpu->isar.mvfr2 = 0x00000040;
      cpu->id_pfr0 = 0x00000030;
      cpu->id_pfr1 = 0x00000210;
      cpu->id_dfr0 = 0x00200000;
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 44/55] i.mx7d: Change SRC unimplemented device name from sdma to src
+[Qemu-devel] [PULL 30/42] hw/dma: Compile the bcm2835_dma device as common object
-From: Jean-Christophe Dubois <jcd@tribudubois.net>
+From: Philippe Mathieu-Daudé <philmd@redhat.com>
-Signed-off-by: Jean-Christophe Dubois <jcd@tribudubois.net>
+This device is used by both ARM (BCM2836, for raspi2) and AArch64
 (BCM2837, for raspi3) targets, and is not CPU-specific.
 Move it to common object, so we build it once for all targets.
 Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Message-id: 20190427133028.12874-1-philmd@redhat.com
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- hw/arm/fsl-imx7.c | 2 +-
+ hw/dma/Makefile.objs | 2 +-
 file changed, 1 insertion(+), 1 deletion(-)
-diff --git a/hw/arm/fsl-imx7.c b/hw/arm/fsl-imx7.c
+diff --git a/hw/dma/Makefile.objs b/hw/dma/Makefile.objs
 index XXXXXXX..XXXXXXX 100644
---- a/hw/arm/fsl-imx7.c
+--- a/hw/dma/Makefile.objs
-+++ b/hw/arm/fsl-imx7.c
++++ b/hw/dma/Makefile.objs
-@@ -XXX,XX +XXX,XX @@ static void fsl_imx7_realize(DeviceState *dev, Error **errp)
+@@ -XXX,XX +XXX,XX @@ common-obj-$(CONFIG_XLNX_ZYNQMP_ARM) += xlnx-zdma.o
-     /*
-      * SRC
+ obj-$(CONFIG_OMAP) += omap_dma.o soc_dma.o
-      */
+ obj-$(CONFIG_PXA2XX) += pxa2xx_dma.o
--    create_unimplemented_device("sdma", FSL_IMX7_SRC_ADDR, FSL_IMX7_SRC_SIZE);
+-obj-$(CONFIG_RASPI) += bcm2835_dma.o
-+    create_unimplemented_device("src", FSL_IMX7_SRC_ADDR, FSL_IMX7_SRC_SIZE);
++common-obj-$(CONFIG_RASPI) += bcm2835_dma.o
      /*
       * Watchdog
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 35/55] target/arm: Implement SVE fp complex multiply add
+[Qemu-devel] [PULL 31/42] hw/arm/aspeed: Use TYPE_TMP105/TYPE_PCA9552 instead of hardcoded string
-From: Richard Henderson <richard.henderson@linaro.org>
+From: Philippe Mathieu-Daudé <philmd@redhat.com>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Thomas Huth <thuth@redhat.com>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Cédric Le Goater <clg@kaod.org>
-Message-id: 20180627043328.11531-30-richard.henderson@linaro.org
+Reviewed-by: Markus Armbruster <armbru@redhat.com>
 Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Message-id: 20190412165416.7977-2-philmd@redhat.com
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper-sve.h    |   4 +
+ hw/arm/aspeed.c | 13 +++++++++----
- target/arm/sve_helper.c    | 162 +++++++++++++++++++++++++++++++++++++
+file changed, 9 insertions(+), 4 deletions(-)
  target/arm/translate-sve.c |  37 +++++++++
  target/arm/sve.decode      |   4 +
 files changed, 207 insertions(+)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
+diff --git a/hw/arm/aspeed.c b/hw/arm/aspeed.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
+--- a/hw/arm/aspeed.c
-+++ b/target/arm/helper-sve.h
++++ b/hw/arm/aspeed.c
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_3(sve_fnmls_zpzzz_h, TCG_CALL_NO_RWG, void, env, ptr, i32)
+@@ -XXX,XX +XXX,XX @@
- DEF_HELPER_FLAGS_3(sve_fnmls_zpzzz_s, TCG_CALL_NO_RWG, void, env, ptr, i32)
+ #include "hw/arm/aspeed_soc.h"
- DEF_HELPER_FLAGS_3(sve_fnmls_zpzzz_d, TCG_CALL_NO_RWG, void, env, ptr, i32)
+ #include "hw/boards.h"
+ #include "hw/i2c/smbus_eeprom.h"
-+DEF_HELPER_FLAGS_3(sve_fcmla_zpzzz_h, TCG_CALL_NO_RWG, void, env, ptr, i32)
++#include "hw/misc/pca9552.h"
-+DEF_HELPER_FLAGS_3(sve_fcmla_zpzzz_s, TCG_CALL_NO_RWG, void, env, ptr, i32)
++#include "hw/misc/tmp105.h"
-+DEF_HELPER_FLAGS_3(sve_fcmla_zpzzz_d, TCG_CALL_NO_RWG, void, env, ptr, i32)
+ #include "qemu/log.h"
-+
+ #include "sysemu/block-backend.h"
- DEF_HELPER_FLAGS_5(sve_ftmad_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, ptr, i32)
+ #include "hw/loader.h"
- DEF_HELPER_FLAGS_5(sve_ftmad_s, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, ptr, i32)
+@@ -XXX,XX +XXX,XX @@ static void ast2500_evb_i2c_init(AspeedBoardState *bmc)
- DEF_HELPER_FLAGS_5(sve_ftmad_d, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, ptr, i32)
+                           eeprom_buf);
-diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
-index XXXXXXX..XXXXXXX 100644
+     /* The AST2500 EVB expects a LM75 but a TMP105 is compatible */
---- a/target/arm/sve_helper.c
+-    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 7), "tmp105", 0x4d);
-+++ b/target/arm/sve_helper.c
++    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 7),
-@@ -XXX,XX +XXX,XX @@ void HELPER(sve_fcadd_d)(void *vd, void *vn, void *vm, void *vg,
++                     TYPE_TMP105, 0x4d);
-     } while (i != 0);
      /* The AST2500 EVB does not have an RTC. Let's pretend that one is
       * plugged on the I2C bus header */
@@ -XXX,XX +XXX,XX @@ static void witherspoon_bmc_i2c_init(AspeedBoardState *bmc)
      AspeedSoCState *soc = &bmc->soc;
      uint8_t *eeprom_buf = g_malloc0(8 * 1024);
 -    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 3), "pca9552", 0x60);
 +    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 3), TYPE_PCA9552,
 +                     0x60);
      i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 4), "tmp423", 0x4c);
      i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 5), "tmp423", 0x4c);
      /* The Witherspoon expects a TMP275 but a TMP105 is compatible */
 -    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 9), "tmp105", 0x4a);
 +    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 9), TYPE_TMP105,
 +                     0x4a);
      /* The witherspoon board expects Epson RX8900 I2C RTC but a ds1338 is
       * good enough */
@@ -XXX,XX +XXX,XX @@ static void witherspoon_bmc_i2c_init(AspeedBoardState *bmc)
      smbus_eeprom_init_one(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 11), 0x51,
                            eeprom_buf);
 -    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 11), "pca9552",
 +    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 11), TYPE_PCA9552,
 x60);
  }
-+/*
-+ * FP Complex Multiply
-+ */
-+
-+QEMU_BUILD_BUG_ON(SIMD_DATA_SHIFT + 22 > 32);
-+
-+void HELPER(sve_fcmla_zpzzz_h)(CPUARMState *env, void *vg, uint32_t desc)
-+{
-+    intptr_t j, i = simd_oprsz(desc);
-+    unsigned rd = extract32(desc, SIMD_DATA_SHIFT, 5);
-+    unsigned rn = extract32(desc, SIMD_DATA_SHIFT + 5, 5);
-+    unsigned rm = extract32(desc, SIMD_DATA_SHIFT + 10, 5);
-+    unsigned ra = extract32(desc, SIMD_DATA_SHIFT + 15, 5);
-+    unsigned rot = extract32(desc, SIMD_DATA_SHIFT + 20, 2);
-+    bool flip = rot & 1;
-+    float16 neg_imag, neg_real;
-+    void *vd = &env->vfp.zregs[rd];
-+    void *vn = &env->vfp.zregs[rn];
-+    void *vm = &env->vfp.zregs[rm];
-+    void *va = &env->vfp.zregs[ra];
-+    uint64_t *g = vg;
-+
-+    neg_imag = float16_set_sign(0, (rot & 2) != 0);
-+    neg_real = float16_set_sign(0, rot == 1 || rot == 2);
-+
-+    do {
-+        uint64_t pg = g[(i - 1) >> 6];
-+        do {
-+            float16 e1, e2, e3, e4, nr, ni, mr, mi, d;
-+
-+            /* I holds the real index; J holds the imag index.  */
-+            j = i - sizeof(float16);
-+            i -= 2 * sizeof(float16);
-+
-+            nr = *(float16 *)(vn + H1_2(i));
-+            ni = *(float16 *)(vn + H1_2(j));
-+            mr = *(float16 *)(vm + H1_2(i));
-+            mi = *(float16 *)(vm + H1_2(j));
-+
-+            e2 = (flip ? ni : nr);
-+            e1 = (flip ? mi : mr) ^ neg_real;
-+            e4 = e2;
-+            e3 = (flip ? mr : mi) ^ neg_imag;
-+
-+            if (likely((pg >> (i & 63)) & 1)) {
-+                d = *(float16 *)(va + H1_2(i));
-+                d = float16_muladd(e2, e1, d, 0, &env->vfp.fp_status_f16);
-+                *(float16 *)(vd + H1_2(i)) = d;
-+            }
-+            if (likely((pg >> (j & 63)) & 1)) {
-+                d = *(float16 *)(va + H1_2(j));
-+                d = float16_muladd(e4, e3, d, 0, &env->vfp.fp_status_f16);
-+                *(float16 *)(vd + H1_2(j)) = d;
-+            }
-+        } while (i & 63);
-+    } while (i != 0);
-+}
-+
-+void HELPER(sve_fcmla_zpzzz_s)(CPUARMState *env, void *vg, uint32_t desc)
-+{
-+    intptr_t j, i = simd_oprsz(desc);
-+    unsigned rd = extract32(desc, SIMD_DATA_SHIFT, 5);
-+    unsigned rn = extract32(desc, SIMD_DATA_SHIFT + 5, 5);
-+    unsigned rm = extract32(desc, SIMD_DATA_SHIFT + 10, 5);
-+    unsigned ra = extract32(desc, SIMD_DATA_SHIFT + 15, 5);
-+    unsigned rot = extract32(desc, SIMD_DATA_SHIFT + 20, 2);
-+    bool flip = rot & 1;
-+    float32 neg_imag, neg_real;
-+    void *vd = &env->vfp.zregs[rd];
-+    void *vn = &env->vfp.zregs[rn];
-+    void *vm = &env->vfp.zregs[rm];
-+    void *va = &env->vfp.zregs[ra];
-+    uint64_t *g = vg;
-+
-+    neg_imag = float32_set_sign(0, (rot & 2) != 0);
-+    neg_real = float32_set_sign(0, rot == 1 || rot == 2);
-+
-+    do {
-+        uint64_t pg = g[(i - 1) >> 6];
-+        do {
-+            float32 e1, e2, e3, e4, nr, ni, mr, mi, d;
-+
-+            /* I holds the real index; J holds the imag index.  */
-+            j = i - sizeof(float32);
-+            i -= 2 * sizeof(float32);
-+
-+            nr = *(float32 *)(vn + H1_2(i));
-+            ni = *(float32 *)(vn + H1_2(j));
-+            mr = *(float32 *)(vm + H1_2(i));
-+            mi = *(float32 *)(vm + H1_2(j));
-+
-+            e2 = (flip ? ni : nr);
-+            e1 = (flip ? mi : mr) ^ neg_real;
-+            e4 = e2;
-+            e3 = (flip ? mr : mi) ^ neg_imag;
-+
-+            if (likely((pg >> (i & 63)) & 1)) {
-+                d = *(float32 *)(va + H1_2(i));
-+                d = float32_muladd(e2, e1, d, 0, &env->vfp.fp_status);
-+                *(float32 *)(vd + H1_2(i)) = d;
-+            }
-+            if (likely((pg >> (j & 63)) & 1)) {
-+                d = *(float32 *)(va + H1_2(j));
-+                d = float32_muladd(e4, e3, d, 0, &env->vfp.fp_status);
-+                *(float32 *)(vd + H1_2(j)) = d;
-+            }
-+        } while (i & 63);
-+    } while (i != 0);
-+}
-+
-+void HELPER(sve_fcmla_zpzzz_d)(CPUARMState *env, void *vg, uint32_t desc)
-+{
-+    intptr_t j, i = simd_oprsz(desc);
-+    unsigned rd = extract32(desc, SIMD_DATA_SHIFT, 5);
-+    unsigned rn = extract32(desc, SIMD_DATA_SHIFT + 5, 5);
-+    unsigned rm = extract32(desc, SIMD_DATA_SHIFT + 10, 5);
-+    unsigned ra = extract32(desc, SIMD_DATA_SHIFT + 15, 5);
-+    unsigned rot = extract32(desc, SIMD_DATA_SHIFT + 20, 2);
-+    bool flip = rot & 1;
-+    float64 neg_imag, neg_real;
-+    void *vd = &env->vfp.zregs[rd];
-+    void *vn = &env->vfp.zregs[rn];
-+    void *vm = &env->vfp.zregs[rm];
-+    void *va = &env->vfp.zregs[ra];
-+    uint64_t *g = vg;
-+
-+    neg_imag = float64_set_sign(0, (rot & 2) != 0);
-+    neg_real = float64_set_sign(0, rot == 1 || rot == 2);
-+
-+    do {
-+        uint64_t pg = g[(i - 1) >> 6];
-+        do {
-+            float64 e1, e2, e3, e4, nr, ni, mr, mi, d;
-+
-+            /* I holds the real index; J holds the imag index.  */
-+            j = i - sizeof(float64);
-+            i -= 2 * sizeof(float64);
-+
-+            nr = *(float64 *)(vn + H1_2(i));
-+            ni = *(float64 *)(vn + H1_2(j));
-+            mr = *(float64 *)(vm + H1_2(i));
-+            mi = *(float64 *)(vm + H1_2(j));
-+
-+            e2 = (flip ? ni : nr);
-+            e1 = (flip ? mi : mr) ^ neg_real;
-+            e4 = e2;
-+            e3 = (flip ? mr : mi) ^ neg_imag;
-+
-+            if (likely((pg >> (i & 63)) & 1)) {
-+                d = *(float64 *)(va + H1_2(i));
-+                d = float64_muladd(e2, e1, d, 0, &env->vfp.fp_status);
-+                *(float64 *)(vd + H1_2(i)) = d;
-+            }
-+            if (likely((pg >> (j & 63)) & 1)) {
-+                d = *(float64 *)(va + H1_2(j));
-+                d = float64_muladd(e4, e3, d, 0, &env->vfp.fp_status);
-+                *(float64 *)(vd + H1_2(j)) = d;
-+            }
-+        } while (i & 63);
-+    } while (i != 0);
-+}
-+
- /*
-  * Load contiguous data, protected by a governing predicate.
-  */
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
-+++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ DO_FMLA(FNMLS_zpzzz, fnmls_zpzzz)
- #undef DO_FMLA
-+static bool trans_FCMLA_zpzzz(DisasContext *s,
-+                              arg_FCMLA_zpzzz *a, uint32_t insn)
-+{
-+    static gen_helper_sve_fmla * const fns[3] = {
-+        gen_helper_sve_fcmla_zpzzz_h,
-+        gen_helper_sve_fcmla_zpzzz_s,
-+        gen_helper_sve_fcmla_zpzzz_d,
-+    };
-+
-+    if (a->esz == 0) {
-+        return false;
-+    }
-+    if (sve_access_check(s)) {
-+        unsigned vsz = vec_full_reg_size(s);
-+        unsigned desc;
-+        TCGv_i32 t_desc;
-+        TCGv_ptr pg = tcg_temp_new_ptr();
-+
-+        /* We would need 7 operands to pass these arguments "properly".
-+         * So we encode all the register numbers into the descriptor.
-+         */
-+        desc = deposit32(a->rd, 5, 5, a->rn);
-+        desc = deposit32(desc, 10, 5, a->rm);
-+        desc = deposit32(desc, 15, 5, a->ra);
-+        desc = deposit32(desc, 20, 2, a->rot);
-+        desc = sextract32(desc, 0, 22);
-+        desc = simd_desc(vsz, vsz, desc);
-+
-+        t_desc = tcg_const_i32(desc);
-+        tcg_gen_addi_ptr(pg, cpu_env, pred_full_reg_offset(s, a->pg));
-+        fns[a->esz - 1](cpu_env, pg, t_desc);
-+        tcg_temp_free_i32(t_desc);
-+        tcg_temp_free_ptr(pg);
-+    }
-+    return true;
-+}
-+
- /*
-  *** SVE Floating Point Unary Operations Predicated Group
-  */
-diff --git a/target/arm/sve.decode b/target/arm/sve.decode
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
-+++ b/target/arm/sve.decode
-@@ -XXX,XX +XXX,XX @@ MUL_zzi         00100101 .. 110 000 110 ........ .....          @rdn_i8s
- FCADD           01100100 esz:2 00000 rot:1 100 pg:3 rm:5 rd:5 \
-                 rn=%reg_movprfx
-+# SVE floating-point complex multiply-add (predicated)
-+FCMLA_zpzzz     01100100 esz:2 0 rm:5 0 rot:2 pg:3 rn:5 rd:5 \
-+                ra=%reg_movprfx
-+
- ### SVE FP Multiply-Add Indexed Group
- # SVE floating-point multiply-add (indexed)
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 45/55] i.mx7d: Change IRQ number type from hwaddr to int
+[Qemu-devel] [PULL 32/42] hw/arm/nseries: Use TYPE_TMP105 instead of hardcoded string
-From: Jean-Christophe Dubois <jcd@tribudubois.net>
+From: Philippe Mathieu-Daudé <philmd@redhat.com>
-The qdev_get_gpio_in() function accept an int as second parameter.
+Suggested-by: Markus Armbruster <armbru@redhat.com>
+Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
-Signed-off-by: Jean-Christophe Dubois <jcd@tribudubois.net>
+Message-id: 20190412165416.7977-3-philmd@redhat.com
 Reviewed-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- hw/arm/fsl-imx7.c | 6 +++---
+ hw/arm/nseries.c | 3 ++-
-file changed, 3 insertions(+), 3 deletions(-)
+file changed, 2 insertions(+), 1 deletion(-)
-diff --git a/hw/arm/fsl-imx7.c b/hw/arm/fsl-imx7.c
+diff --git a/hw/arm/nseries.c b/hw/arm/nseries.c
 index XXXXXXX..XXXXXXX 100644
---- a/hw/arm/fsl-imx7.c
+--- a/hw/arm/nseries.c
-+++ b/hw/arm/fsl-imx7.c
++++ b/hw/arm/nseries.c
-@@ -XXX,XX +XXX,XX @@ static void fsl_imx7_realize(DeviceState *dev, Error **errp)
+@@ -XXX,XX +XXX,XX @@
-             FSL_IMX7_ECSPI4_ADDR,
+ #include "hw/boards.h"
-         };
+ #include "hw/i2c/i2c.h"
+ #include "hw/devices.h"
--        static const hwaddr FSL_IMX7_SPIn_IRQ[FSL_IMX7_NUM_ECSPIS] = {
++#include "hw/misc/tmp105.h"
-+        static const int FSL_IMX7_SPIn_IRQ[FSL_IMX7_NUM_ECSPIS] = {
+ #include "hw/block/flash.h"
-             FSL_IMX7_ECSPI1_IRQ,
+ #include "hw/hw.h"
-             FSL_IMX7_ECSPI2_IRQ,
+ #include "hw/bt.h"
-             FSL_IMX7_ECSPI3_IRQ,
+@@ -XXX,XX +XXX,XX @@ static void n8x0_i2c_setup(struct n800_s *s)
-@@ -XXX,XX +XXX,XX @@ static void fsl_imx7_realize(DeviceState *dev, Error **errp)
+     qemu_register_powerdown_notifier(&n8x0_system_powerdown_notifier);
-             FSL_IMX7_I2C4_ADDR,
-         };
+     /* Attach a TMP105 PM chip (A0 wired to ground) */
+-    dev = i2c_create_slave(i2c, "tmp105", N8X0_TMP105_ADDR);
--        static const hwaddr FSL_IMX7_I2Cn_IRQ[FSL_IMX7_NUM_I2CS] = {
++    dev = i2c_create_slave(i2c, TYPE_TMP105, N8X0_TMP105_ADDR);
-+        static const int FSL_IMX7_I2Cn_IRQ[FSL_IMX7_NUM_I2CS] = {
+     qdev_connect_gpio_out(dev, 0, tmp_irq);
-             FSL_IMX7_I2C1_IRQ,
+ }
-             FSL_IMX7_I2C2_IRQ,
              FSL_IMX7_I2C3_IRQ,
@@ -XXX,XX +XXX,XX @@ static void fsl_imx7_realize(DeviceState *dev, Error **errp)
              FSL_IMX7_USB3_ADDR,
          };
 -        static const hwaddr FSL_IMX7_USBn_IRQ[FSL_IMX7_NUM_USBS] = {
 +        static const int FSL_IMX7_USBn_IRQ[FSL_IMX7_NUM_USBS] = {
              FSL_IMX7_USB1_IRQ,
              FSL_IMX7_USB2_IRQ,
              FSL_IMX7_USB3_IRQ,
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 43/55] i.mx7d: Remove unused header files
+[Qemu-devel] [PULL 33/42] hw/display/tc6393xb: Remove unused functions
-From: Jean-Christophe Dubois <jcd@tribudubois.net>
+From: Philippe Mathieu-Daudé <philmd@redhat.com>
-Signed-off-by: Jean-Christophe Dubois <jcd@tribudubois.net>
+No code used the tc6393xb_gpio_in_get() and tc6393xb_gpio_out_set()
 functions since their introduction in commit 88d2c950b002. Time to
 remove them.
 Suggested-by: Markus Armbruster <armbru@redhat.com>
 Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Message-id: 20190412165416.7977-4-philmd@redhat.com
 Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- hw/arm/mcimx7d-sabre.c | 2 --
+ include/hw/devices.h  |  3 ---
-file changed, 2 deletions(-)
+ hw/display/tc6393xb.c | 16 ----------------
 files changed, 19 deletions(-)
-diff --git a/hw/arm/mcimx7d-sabre.c b/hw/arm/mcimx7d-sabre.c
+diff --git a/include/hw/devices.h b/include/hw/devices.h
 index XXXXXXX..XXXXXXX 100644
---- a/hw/arm/mcimx7d-sabre.c
+--- a/include/hw/devices.h
-+++ b/hw/arm/mcimx7d-sabre.c
++++ b/include/hw/devices.h
-@@ -XXX,XX +XXX,XX @@
+@@ -XXX,XX +XXX,XX @@ void retu_key_event(void *retu, int state);
- #include "hw/arm/fsl-imx7.h"
+ typedef struct TC6393xbState TC6393xbState;
- #include "hw/boards.h"
+ TC6393xbState *tc6393xb_init(struct MemoryRegion *sysmem,
- #include "sysemu/sysemu.h"
+                              uint32_t base, qemu_irq irq);
--#include "sysemu/device_tree.h"
+-void tc6393xb_gpio_out_set(TC6393xbState *s, int line,
- #include "qemu/error-report.h"
+-                    qemu_irq handler);
- #include "sysemu/qtest.h"
+-qemu_irq *tc6393xb_gpio_in_get(TC6393xbState *s);
--#include "net/net.h"
+ qemu_irq tc6393xb_l3v_get(TC6393xbState *s);
- typedef struct {
+ #endif
-     FslIMX7State soc;
+diff --git a/hw/display/tc6393xb.c b/hw/display/tc6393xb.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/display/tc6393xb.c
 +++ b/hw/display/tc6393xb.c
@@ -XXX,XX +XXX,XX @@ struct TC6393xbState {
               blanked : 1;
  };
 -qemu_irq *tc6393xb_gpio_in_get(TC6393xbState *s)
 -{
 -    return s->gpio_in;
 -}
 -
  static void tc6393xb_gpio_set(void *opaque, int line, int level)
  {
  //    TC6393xbState *s = opaque;
@@ -XXX,XX +XXX,XX @@ static void tc6393xb_gpio_set(void *opaque, int line, int level)
      // FIXME: how does the chip reflect the GPIO input level change?
  }
 -void tc6393xb_gpio_out_set(TC6393xbState *s, int line,
 -                    qemu_irq handler)
 -{
 -    if (line >= TC6393XB_GPIOS) {
 -        fprintf(stderr, "TC6393xb: no GPIO pin %d\n", line);
 -        return;
 -    }
 -
 -    s->handler[line] = handler;
 -}
 -
  static void tc6393xb_gpio_handler_update(TC6393xbState *s)
  {
      uint32_t level, diff;
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 28/55] target/arm: Implement SVE floating-point trig multiply-add coefficient
+[Qemu-devel] [PULL 34/42] hw/devices: Move TC6393XB declarations into a new header
-From: Richard Henderson <richard.henderson@linaro.org>
+From: Philippe Mathieu-Daudé <philmd@redhat.com>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Markus Armbruster <armbru@redhat.com>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
-Message-id: 20180627043328.11531-23-richard.henderson@linaro.org
+Message-id: 20190412165416.7977-5-philmd@redhat.com
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper-sve.h    |  4 +++
+ include/hw/devices.h          |  6 ------
- target/arm/sve_helper.c    | 70 ++++++++++++++++++++++++++++++++++++++
+ include/hw/display/tc6393xb.h | 24 ++++++++++++++++++++++++
- target/arm/translate-sve.c | 27 +++++++++++++++
+ hw/arm/tosa.c                 |  2 +-
- target/arm/sve.decode      |  3 ++
+ hw/display/tc6393xb.c         |  2 +-
-files changed, 104 insertions(+)
+ MAINTAINERS                   |  1 +
 files changed, 27 insertions(+), 8 deletions(-)
  create mode 100644 include/hw/display/tc6393xb.h
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
+diff --git a/include/hw/devices.h b/include/hw/devices.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
+--- a/include/hw/devices.h
-+++ b/target/arm/helper-sve.h
++++ b/include/hw/devices.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_3(sve_fnmls_zpzzz_h, TCG_CALL_NO_RWG, void, env, ptr, i32)
+@@ -XXX,XX +XXX,XX @@ void *tahvo_init(qemu_irq irq, int betty);
- DEF_HELPER_FLAGS_3(sve_fnmls_zpzzz_s, TCG_CALL_NO_RWG, void, env, ptr, i32)
- DEF_HELPER_FLAGS_3(sve_fnmls_zpzzz_d, TCG_CALL_NO_RWG, void, env, ptr, i32)
+ void retu_key_event(void *retu, int state);
-+DEF_HELPER_FLAGS_5(sve_ftmad_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, ptr, i32)
+-/* tc6393xb.c */
-+DEF_HELPER_FLAGS_5(sve_ftmad_s, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, ptr, i32)
+-typedef struct TC6393xbState TC6393xbState;
-+DEF_HELPER_FLAGS_5(sve_ftmad_d, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, ptr, i32)
+-TC6393xbState *tc6393xb_init(struct MemoryRegion *sysmem,
-+
+-                             uint32_t base, qemu_irq irq);
- DEF_HELPER_FLAGS_4(sve_ld1bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+-qemu_irq tc6393xb_l3v_get(TC6393xbState *s);
- DEF_HELPER_FLAGS_4(sve_ld2bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+-
- DEF_HELPER_FLAGS_4(sve_ld3bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+ #endif
-diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
+diff --git a/include/hw/display/tc6393xb.h b/include/hw/display/tc6393xb.h
-index XXXXXXX..XXXXXXX 100644
+new file mode 100644
---- a/target/arm/sve_helper.c
+index XXXXXXX..XXXXXXX
-+++ b/target/arm/sve_helper.c
+--- /dev/null
-@@ -XXX,XX +XXX,XX @@ DO_FPCMP_PPZ0_ALL(sve_fcmlt0, DO_FCMLT)
++++ b/include/hw/display/tc6393xb.h
- DO_FPCMP_PPZ0_ALL(sve_fcmeq0, DO_FCMEQ)
+@@ -XXX,XX +XXX,XX @@
  DO_FPCMP_PPZ0_ALL(sve_fcmne0, DO_FCMNE)
 +/* FP Trig Multiply-Add. */
 +
 +void HELPER(sve_ftmad_h)(void *vd, void *vn, void *vm, void *vs, uint32_t desc)
 +{
 +    static const float16 coeff[16] = {
 +        0x3c00, 0xb155, 0x2030, 0x0000, 0x0000, 0x0000, 0x0000, 0x0000,
 +        0x3c00, 0xb800, 0x293a, 0x0000, 0x0000, 0x0000, 0x0000, 0x0000,
 +    };
 +    intptr_t i, opr_sz = simd_oprsz(desc) / sizeof(float16);
 +    intptr_t x = simd_data(desc);
 +    float16 *d = vd, *n = vn, *m = vm;
 +    for (i = 0; i < opr_sz; i++) {
 +        float16 mm = m[i];
 +        intptr_t xx = x;
 +        if (float16_is_neg(mm)) {
 +            mm = float16_abs(mm);
 +            xx += 8;
 +        }
 +        d[i] = float16_muladd(n[i], mm, coeff[xx], 0, vs);
 +    }
 +}
 +
 +void HELPER(sve_ftmad_s)(void *vd, void *vn, void *vm, void *vs, uint32_t desc)
 +{
 +    static const float32 coeff[16] = {
 +        0x3f800000, 0xbe2aaaab, 0x3c088886, 0xb95008b9,
 +        0x36369d6d, 0x00000000, 0x00000000, 0x00000000,
 +        0x3f800000, 0xbf000000, 0x3d2aaaa6, 0xbab60705,
 +        0x37cd37cc, 0x00000000, 0x00000000, 0x00000000,
 +    };
 +    intptr_t i, opr_sz = simd_oprsz(desc) / sizeof(float32);
 +    intptr_t x = simd_data(desc);
 +    float32 *d = vd, *n = vn, *m = vm;
 +    for (i = 0; i < opr_sz; i++) {
 +        float32 mm = m[i];
 +        intptr_t xx = x;
 +        if (float32_is_neg(mm)) {
 +            mm = float32_abs(mm);
 +            xx += 8;
 +        }
 +        d[i] = float32_muladd(n[i], mm, coeff[xx], 0, vs);
 +    }
 +}
 +
 +void HELPER(sve_ftmad_d)(void *vd, void *vn, void *vm, void *vs, uint32_t desc)
 +{
 +    static const float64 coeff[16] = {
 +        0x3ff0000000000000ull, 0xbfc5555555555543ull,
 +        0x3f8111111110f30cull, 0xbf2a01a019b92fc6ull,
 +        0x3ec71de351f3d22bull, 0xbe5ae5e2b60f7b91ull,
 +        0x3de5d8408868552full, 0x0000000000000000ull,
 +        0x3ff0000000000000ull, 0xbfe0000000000000ull,
 +        0x3fa5555555555536ull, 0xbf56c16c16c13a0bull,
 +        0x3efa01a019b1e8d8ull, 0xbe927e4f7282f468ull,
 +        0x3e21ee96d2641b13ull, 0xbda8f76380fbb401ull,
 +    };
 +    intptr_t i, opr_sz = simd_oprsz(desc) / sizeof(float64);
 +    intptr_t x = simd_data(desc);
 +    float64 *d = vd, *n = vn, *m = vm;
 +    for (i = 0; i < opr_sz; i++) {
 +        float64 mm = m[i];
 +        intptr_t xx = x;
 +        if (float64_is_neg(mm)) {
 +            mm = float64_abs(mm);
 +            xx += 8;
 +        }
 +        d[i] = float64_muladd(n[i], mm, coeff[xx], 0, vs);
 +    }
 +}
 +
  /*
   * Load contiguous data, protected by a governing predicate.
   */
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-sve.c
 +++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ DO_PPZ(FCMNE_ppz0, fcmne0)
  #undef DO_PPZ
 +/*
-+ *** SVE floating-point trig multiply-add coefficient
++ * Toshiba TC6393XB I/O Controller.
 + * Found in Sharp Zaurus SL-6000 (tosa) or some
 + * Toshiba e-Series PDAs.
 + *
 + * Copyright (c) 2007 Hervé Poussineau
 + *
 + * This work is licensed under the terms of the GNU GPL, version 2 or later.
 + * See the COPYING file in the top-level directory.
 + */
 +
-+static bool trans_FTMAD(DisasContext *s, arg_FTMAD *a, uint32_t insn)
++#ifndef HW_DISPLAY_TC6393XB_H
-+{
++#define HW_DISPLAY_TC6393XB_H
 +    static gen_helper_gvec_3_ptr * const fns[3] = {
 +        gen_helper_sve_ftmad_h,
 +        gen_helper_sve_ftmad_s,
 +        gen_helper_sve_ftmad_d,
 +    };
 +
-+    if (a->esz == 0) {
++#include "exec/memory.h"
-+        return false;
++#include "hw/irq.h"
 +    }
 +    if (sve_access_check(s)) {
 +        unsigned vsz = vec_full_reg_size(s);
 +        TCGv_ptr status = get_fpstatus_ptr(a->esz == MO_16);
 +        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, a->rd),
 +                           vec_full_reg_offset(s, a->rn),
 +                           vec_full_reg_offset(s, a->rm),
 +                           status, vsz, vsz, a->imm, fns[a->esz - 1]);
 +        tcg_temp_free_ptr(status);
 +    }
 +    return true;
 +}
 +
- /*
++typedef struct TC6393xbState TC6393xbState;
-  *** SVE Floating Point Accumulating Reduction Group
++
-  */
++TC6393xbState *tc6393xb_init(struct MemoryRegion *sysmem,
-diff --git a/target/arm/sve.decode b/target/arm/sve.decode
++                             uint32_t base, qemu_irq irq);
 +qemu_irq tc6393xb_l3v_get(TC6393xbState *s);
 +
 +#endif
 diff --git a/hw/arm/tosa.c b/hw/arm/tosa.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
+--- a/hw/arm/tosa.c
-+++ b/target/arm/sve.decode
++++ b/hw/arm/tosa.c
-@@ -XXX,XX +XXX,XX @@ FMINNM_zpzi     01100101 .. 011 101 100 ... 0000 . .....        @rdn_i1
+@@ -XXX,XX +XXX,XX @@
- FMAX_zpzi       01100101 .. 011 110 100 ... 0000 . .....        @rdn_i1
+ #include "hw/hw.h"
- FMIN_zpzi       01100101 .. 011 111 100 ... 0000 . .....        @rdn_i1
+ #include "hw/arm/pxa.h"
+ #include "hw/arm/arm.h"
-+# SVE floating-point trig multiply-add coefficient
+-#include "hw/devices.h"
-+FTMAD           01100101 esz:2 010 imm:3 100000 rm:5 rd:5       rn=%reg_movprfx
+ #include "hw/arm/sharpsl.h"
-+
+ #include "hw/pcmcia.h"
- ### SVE FP Multiply-Add Group
+ #include "hw/boards.h"
++#include "hw/display/tc6393xb.h"
- # SVE floating-point multiply-accumulate writing addend
+ #include "hw/i2c/i2c.h"
  #include "hw/ssi/ssi.h"
  #include "hw/sysbus.h"
 diff --git a/hw/display/tc6393xb.c b/hw/display/tc6393xb.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/display/tc6393xb.c
 +++ b/hw/display/tc6393xb.c
@@ -XXX,XX +XXX,XX @@
  #include "qapi/error.h"
  #include "qemu/host-utils.h"
  #include "hw/hw.h"
 -#include "hw/devices.h"
 +#include "hw/display/tc6393xb.h"
  #include "hw/block/flash.h"
  #include "ui/console.h"
  #include "ui/pixel_ops.h"
 diff --git a/MAINTAINERS b/MAINTAINERS
 index XXXXXXX..XXXXXXX 100644
 --- a/MAINTAINERS
 +++ b/MAINTAINERS
@@ -XXX,XX +XXX,XX @@ F: hw/misc/mst_fpga.c
  F: hw/misc/max111x.c
  F: include/hw/arm/pxa.h
  F: include/hw/arm/sharpsl.h
 +F: include/hw/display/tc6393xb.h
  SABRELITE / i.MX6
  M: Peter Maydell <peter.maydell@linaro.org>
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 27/55] target/arm: Implement SVE FP Compare with Zero Group
+[Qemu-devel] [PULL 35/42] hw/devices: Move Blizzard declarations into a new header
-From: Richard Henderson <richard.henderson@linaro.org>
+From: Philippe Mathieu-Daudé <philmd@redhat.com>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Add an entries the Blizzard device in MAINTAINERS.
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20180627043328.11531-22-richard.henderson@linaro.org
+Reviewed-by: Thomas Huth <thuth@redhat.com>
 Reviewed-by: Markus Armbruster <armbru@redhat.com>
 Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Message-id: 20190412165416.7977-6-philmd@redhat.com
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper-sve.h    | 42 +++++++++++++++++++++++++++++++++++++
+ include/hw/devices.h          |  7 -------
- target/arm/sve_helper.c    | 43 ++++++++++++++++++++++++++++++++++++++
+ include/hw/display/blizzard.h | 22 ++++++++++++++++++++++
- target/arm/translate-sve.c | 43 ++++++++++++++++++++++++++++++++++++++
+ hw/arm/nseries.c              |  1 +
- target/arm/sve.decode      | 10 +++++++++
+ hw/display/blizzard.c         |  2 +-
-files changed, 138 insertions(+)
+ MAINTAINERS                   |  2 ++
 files changed, 26 insertions(+), 8 deletions(-)
  create mode 100644 include/hw/display/blizzard.h
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
+diff --git a/include/hw/devices.h b/include/hw/devices.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
+--- a/include/hw/devices.h
-+++ b/target/arm/helper-sve.h
++++ b/include/hw/devices.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_5(sve_fadda_s, TCG_CALL_NO_RWG,
+@@ -XXX,XX +XXX,XX @@ void tsc2005_set_transform(void *opaque, MouseTransformInfo *info);
- DEF_HELPER_FLAGS_5(sve_fadda_d, TCG_CALL_NO_RWG,
+ /* stellaris_input.c */
-                    i64, i64, ptr, ptr, ptr, i32)
+ void stellaris_gamepad_init(int n, qemu_irq *irq, const int *keycode);
-+DEF_HELPER_FLAGS_5(sve_fcmge0_h, TCG_CALL_NO_RWG,
+-/* blizzard.c */
-+                   void, ptr, ptr, ptr, ptr, i32)
+-void *s1d13745_init(qemu_irq gpio_int);
-+DEF_HELPER_FLAGS_5(sve_fcmge0_s, TCG_CALL_NO_RWG,
+-void s1d13745_write(void *opaque, int dc, uint16_t value);
-+                   void, ptr, ptr, ptr, ptr, i32)
+-void s1d13745_write_block(void *opaque, int dc,
-+DEF_HELPER_FLAGS_5(sve_fcmge0_d, TCG_CALL_NO_RWG,
+-                void *buf, size_t len, int pitch);
-+                   void, ptr, ptr, ptr, ptr, i32)
+-uint16_t s1d13745_read(void *opaque, int dc);
-+
+-
-+DEF_HELPER_FLAGS_5(sve_fcmgt0_h, TCG_CALL_NO_RWG,
+ /* cbus.c */
-+                   void, ptr, ptr, ptr, ptr, i32)
+ typedef struct {
-+DEF_HELPER_FLAGS_5(sve_fcmgt0_s, TCG_CALL_NO_RWG,
+     qemu_irq clk;
-+                   void, ptr, ptr, ptr, ptr, i32)
+diff --git a/include/hw/display/blizzard.h b/include/hw/display/blizzard.h
-+DEF_HELPER_FLAGS_5(sve_fcmgt0_d, TCG_CALL_NO_RWG,
+new file mode 100644
-+                   void, ptr, ptr, ptr, ptr, i32)
+index XXXXXXX..XXXXXXX
-+
+--- /dev/null
-+DEF_HELPER_FLAGS_5(sve_fcmlt0_h, TCG_CALL_NO_RWG,
++++ b/include/hw/display/blizzard.h
-+                   void, ptr, ptr, ptr, ptr, i32)
+@@ -XXX,XX +XXX,XX @@
 +DEF_HELPER_FLAGS_5(sve_fcmlt0_s, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_5(sve_fcmlt0_d, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +
 +DEF_HELPER_FLAGS_5(sve_fcmle0_h, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_5(sve_fcmle0_s, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_5(sve_fcmle0_d, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +
 +DEF_HELPER_FLAGS_5(sve_fcmeq0_h, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_5(sve_fcmeq0_s, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_5(sve_fcmeq0_d, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +
 +DEF_HELPER_FLAGS_5(sve_fcmne0_h, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_5(sve_fcmne0_s, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_5(sve_fcmne0_d, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, i32)
 +
  DEF_HELPER_FLAGS_6(sve_fadd_h, TCG_CALL_NO_RWG,
                     void, ptr, ptr, ptr, ptr, ptr, i32)
  DEF_HELPER_FLAGS_6(sve_fadd_s, TCG_CALL_NO_RWG,
 diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve_helper.c
 +++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(NAME)(void *vd, void *vn, void *vm, void *vg,               \
  #define DO_FCMGE(TYPE, X, Y, ST)  TYPE##_compare(Y, X, ST) <= 0
  #define DO_FCMGT(TYPE, X, Y, ST)  TYPE##_compare(Y, X, ST) < 0
 +#define DO_FCMLE(TYPE, X, Y, ST)  TYPE##_compare(X, Y, ST) <= 0
 +#define DO_FCMLT(TYPE, X, Y, ST)  TYPE##_compare(X, Y, ST) < 0
  #define DO_FCMEQ(TYPE, X, Y, ST)  TYPE##_compare_quiet(X, Y, ST) == 0
  #define DO_FCMNE(TYPE, X, Y, ST)  TYPE##_compare_quiet(X, Y, ST) != 0
  #define DO_FCMUO(TYPE, X, Y, ST)  \
@@ -XXX,XX +XXX,XX @@ DO_FPCMP_PPZZ_ALL(sve_facgt, DO_FACGT)
  #undef DO_FPCMP_PPZZ_H
  #undef DO_FPCMP_PPZZ
 +/* One operand floating-point comparison against zero, controlled
 + * by a predicate.
 + */
 +#define DO_FPCMP_PPZ0(NAME, TYPE, H, OP)                   \
 +void HELPER(NAME)(void *vd, void *vn, void *vg,            \
 +                  void *status, uint32_t desc)             \
 +{                                                          \
 +    intptr_t i = simd_oprsz(desc), j = (i - 1) >> 6;       \
 +    uint64_t *d = vd, *g = vg;                             \
 +    do {                                                   \
 +        uint64_t out = 0, pg = g[j];                       \
 +        do {                                               \
 +            i -= sizeof(TYPE), out <<= sizeof(TYPE);       \
 +            if ((pg >> (i & 63)) & 1) {                    \
 +                TYPE nn = *(TYPE *)(vn + H(i));            \
 +                out |= OP(TYPE, nn, 0, status);            \
 +            }                                              \
 +        } while (i & 63);                                  \
 +        d[j--] = out;                                      \
 +    } while (i > 0);                                       \
 +}
 +
 +#define DO_FPCMP_PPZ0_H(NAME, OP) \
 +    DO_FPCMP_PPZ0(NAME##_h, float16, H1_2, OP)
 +#define DO_FPCMP_PPZ0_S(NAME, OP) \
 +    DO_FPCMP_PPZ0(NAME##_s, float32, H1_4, OP)
 +#define DO_FPCMP_PPZ0_D(NAME, OP) \
 +    DO_FPCMP_PPZ0(NAME##_d, float64,     , OP)
 +
 +#define DO_FPCMP_PPZ0_ALL(NAME, OP) \
 +    DO_FPCMP_PPZ0_H(NAME, OP)   \
 +    DO_FPCMP_PPZ0_S(NAME, OP)   \
 +    DO_FPCMP_PPZ0_D(NAME, OP)
 +
 +DO_FPCMP_PPZ0_ALL(sve_fcmge0, DO_FCMGE)
 +DO_FPCMP_PPZ0_ALL(sve_fcmgt0, DO_FCMGT)
 +DO_FPCMP_PPZ0_ALL(sve_fcmle0, DO_FCMLE)
 +DO_FPCMP_PPZ0_ALL(sve_fcmlt0, DO_FCMLT)
 +DO_FPCMP_PPZ0_ALL(sve_fcmeq0, DO_FCMEQ)
 +DO_FPCMP_PPZ0_ALL(sve_fcmne0, DO_FCMNE)
 +
  /*
   * Load contiguous data, protected by a governing predicate.
   */
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-sve.c
 +++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_FRSQRTE(DisasContext *s, arg_rr_esz *a, uint32_t insn)
      return true;
  }
 +/*
-+ *** SVE Floating Point Compare with Zero Group
++ * Epson S1D13744/S1D13745 (Blizzard/Hailstorm/Tornado) LCD/TV controller.
 + *
 + * Copyright (C) 2008 Nokia Corporation
 + * Written by Andrzej Zaborowski
 + *
 + * This work is licensed under the terms of the GNU GPL, version 2 or later.
 + * See the COPYING file in the top-level directory.
 + */
 +
-+static void do_ppz_fp(DisasContext *s, arg_rpr_esz *a,
++#ifndef HW_DISPLAY_BLIZZARD_H
-+                      gen_helper_gvec_3_ptr *fn)
++#define HW_DISPLAY_BLIZZARD_H
 +{
 +    unsigned vsz = vec_full_reg_size(s);
 +    TCGv_ptr status = get_fpstatus_ptr(a->esz == MO_16);
 +
-+    tcg_gen_gvec_3_ptr(pred_full_reg_offset(s, a->rd),
++#include "hw/irq.h"
 +                       vec_full_reg_offset(s, a->rn),
 +                       pred_full_reg_offset(s, a->pg),
 +                       status, vsz, vsz, 0, fn);
 +    tcg_temp_free_ptr(status);
 +}
 +
-+#define DO_PPZ(NAME, name) \
++void *s1d13745_init(qemu_irq gpio_int);
-+static bool trans_##NAME(DisasContext *s, arg_rpr_esz *a, uint32_t insn) \
++void s1d13745_write(void *opaque, int dc, uint16_t value);
-+{                                                                 \
++void s1d13745_write_block(void *opaque, int dc,
-+    static gen_helper_gvec_3_ptr * const fns[3] = {               \
++                          void *buf, size_t len, int pitch);
-+        gen_helper_sve_##name##_h,                                \
++uint16_t s1d13745_read(void *opaque, int dc);
 +        gen_helper_sve_##name##_s,                                \
 +        gen_helper_sve_##name##_d,                                \
 +    };                                                            \
 +    if (a->esz == 0) {                                            \
 +        return false;                                             \
 +    }                                                             \
 +    if (sve_access_check(s)) {                                    \
 +        do_ppz_fp(s, a, fns[a->esz - 1]);                         \
 +    }                                                             \
 +    return true;                                                  \
 +}
 +
-+DO_PPZ(FCMGE_ppz0, fcmge0)
++#endif
-+DO_PPZ(FCMGT_ppz0, fcmgt0)
+diff --git a/hw/arm/nseries.c b/hw/arm/nseries.c
 +DO_PPZ(FCMLE_ppz0, fcmle0)
 +DO_PPZ(FCMLT_ppz0, fcmlt0)
 +DO_PPZ(FCMEQ_ppz0, fcmeq0)
 +DO_PPZ(FCMNE_ppz0, fcmne0)
 +
 +#undef DO_PPZ
 +
  /*
   *** SVE Floating Point Accumulating Reduction Group
   */
 diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
+--- a/hw/arm/nseries.c
-+++ b/target/arm/sve.decode
++++ b/hw/arm/nseries.c
 @@ -XXX,XX +XXX,XX @@
- # One register operand, with governing predicate, vector element size
+ #include "hw/boards.h"
- @rd_pg_rn       ........ esz:2 ... ... ... pg:3 rn:5 rd:5       &rpr_esz
+ #include "hw/i2c/i2c.h"
- @rd_pg4_pn      ........ esz:2 ... ... .. pg:4 . rn:4 rd:5      &rpr_esz
+ #include "hw/devices.h"
-+@pd_pg_rn       ........ esz:2 ... ... ... pg:3 rn:5 . rd:4     &rpr_esz
++#include "hw/display/blizzard.h"
+ #include "hw/misc/tmp105.h"
- # One register operand, with governing predicate, no vector element size
+ #include "hw/block/flash.h"
- @rd_pg_rn_e0    ........ .. ... ... ... pg:3 rn:5 rd:5          &rpr_esz esz=0
+ #include "hw/hw.h"
-@@ -XXX,XX +XXX,XX @@ FMINV           01100101 .. 000 111 001 ... ..... .....         @rd_pg_rn
+diff --git a/hw/display/blizzard.c b/hw/display/blizzard.c
- FRECPE          01100101 .. 001 110 001100 ..... .....          @rd_rn
+index XXXXXXX..XXXXXXX 100644
- FRSQRTE         01100101 .. 001 111 001100 ..... .....          @rd_rn
+--- a/hw/display/blizzard.c
++++ b/hw/display/blizzard.c
-+### SVE FP Compare with Zero Group
+@@ -XXX,XX +XXX,XX @@
-+
+ #include "qemu/osdep.h"
-+FCMGE_ppz0      01100101 .. 0100 00 001 ... ..... 0 ....        @pd_pg_rn
+ #include "qemu-common.h"
-+FCMGT_ppz0      01100101 .. 0100 00 001 ... ..... 1 ....        @pd_pg_rn
+ #include "ui/console.h"
-+FCMLT_ppz0      01100101 .. 0100 01 001 ... ..... 0 ....        @pd_pg_rn
+-#include "hw/devices.h"
-+FCMLE_ppz0      01100101 .. 0100 01 001 ... ..... 1 ....        @pd_pg_rn
++#include "hw/display/blizzard.h"
-+FCMEQ_ppz0      01100101 .. 0100 10 001 ... ..... 0 ....        @pd_pg_rn
+ #include "ui/pixel_ops.h"
-+FCMNE_ppz0      01100101 .. 0100 11 001 ... ..... 0 ....        @pd_pg_rn
-+
+ typedef void (*blizzard_fn_t)(uint8_t *, const uint8_t *, unsigned int);
- ### SVE FP Accumulating Reduction Group
+diff --git a/MAINTAINERS b/MAINTAINERS
+index XXXXXXX..XXXXXXX 100644
- # SVE floating-point serial reduction (predicated)
+--- a/MAINTAINERS
 +++ b/MAINTAINERS
@@ -XXX,XX +XXX,XX @@ M: Peter Maydell <peter.maydell@linaro.org>
  L: qemu-arm@nongnu.org
  S: Odd Fixes
  F: hw/arm/nseries.c
 +F: hw/display/blizzard.c
  F: hw/input/lm832x.c
  F: hw/input/tsc2005.c
  F: hw/misc/cbus.c
  F: hw/timer/twl92230.c
 +F: include/hw/display/blizzard.h
  Palm
  M: Andrzej Zaborowski <balrogg@gmail.com>
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 26/55] target/arm: Implement SVE Floating Point Unary Operations - Unpredicated Group
+[Qemu-devel] [PULL 36/42] hw/devices: Move CBus declarations into a new header
-From: Richard Henderson <richard.henderson@linaro.org>
+From: Philippe Mathieu-Daudé <philmd@redhat.com>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Thomas Huth <thuth@redhat.com>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Markus Armbruster <armbru@redhat.com>
-Message-id: 20180627043328.11531-21-richard.henderson@linaro.org
+Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Message-id: 20190412165416.7977-7-philmd@redhat.com
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper.h        |  8 +++++++
+ include/hw/devices.h   | 14 --------------
- target/arm/translate-sve.c | 47 ++++++++++++++++++++++++++++++++++++++
+ include/hw/misc/cbus.h | 32 ++++++++++++++++++++++++++++++++
- target/arm/vec_helper.c    | 20 ++++++++++++++++
+ hw/arm/nseries.c       |  1 +
- target/arm/sve.decode      |  5 ++++
+ hw/misc/cbus.c         |  2 +-
-files changed, 80 insertions(+)
+ MAINTAINERS            |  1 +
 files changed, 35 insertions(+), 15 deletions(-)
  create mode 100644 include/hw/misc/cbus.h
-diff --git a/target/arm/helper.h b/target/arm/helper.h
+diff --git a/include/hw/devices.h b/include/hw/devices.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.h
+--- a/include/hw/devices.h
-+++ b/target/arm/helper.h
++++ b/include/hw/devices.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_5(gvec_fcmlas_idx, TCG_CALL_NO_RWG,
+@@ -XXX,XX +XXX,XX @@ void tsc2005_set_transform(void *opaque, MouseTransformInfo *info);
- DEF_HELPER_FLAGS_5(gvec_fcmlad, TCG_CALL_NO_RWG,
+ /* stellaris_input.c */
-                    void, ptr, ptr, ptr, ptr, i32)
+ void stellaris_gamepad_init(int n, qemu_irq *irq, const int *keycode);
-+DEF_HELPER_FLAGS_4(gvec_frecpe_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
+-/* cbus.c */
-+DEF_HELPER_FLAGS_4(gvec_frecpe_s, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
+-typedef struct {
-+DEF_HELPER_FLAGS_4(gvec_frecpe_d, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
+-    qemu_irq clk;
-+
+-    qemu_irq dat;
-+DEF_HELPER_FLAGS_4(gvec_frsqrte_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
+-    qemu_irq sel;
-+DEF_HELPER_FLAGS_4(gvec_frsqrte_s, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
+-} CBus;
-+DEF_HELPER_FLAGS_4(gvec_frsqrte_d, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
+-CBus *cbus_init(qemu_irq dat_out);
-+
+-void cbus_attach(CBus *bus, void *slave_opaque);
- DEF_HELPER_FLAGS_5(gvec_fadd_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, ptr, i32)
+-
- DEF_HELPER_FLAGS_5(gvec_fadd_s, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, ptr, i32)
+-void *retu_init(qemu_irq irq, int vilma);
- DEF_HELPER_FLAGS_5(gvec_fadd_d, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, ptr, i32)
+-void *tahvo_init(qemu_irq irq, int betty);
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+-
-index XXXXXXX..XXXXXXX 100644
+-void retu_key_event(void *retu, int state);
---- a/target/arm/translate-sve.c
+-
-+++ b/target/arm/translate-sve.c
+ #endif
-@@ -XXX,XX +XXX,XX @@ DO_VPZ(FMAXNMV, fmaxnmv)
+diff --git a/include/hw/misc/cbus.h b/include/hw/misc/cbus.h
- DO_VPZ(FMINV, fminv)
+new file mode 100644
- DO_VPZ(FMAXV, fmaxv)
+index XXXXXXX..XXXXXXX
+--- /dev/null
 +++ b/include/hw/misc/cbus.h
@@ -XXX,XX +XXX,XX @@
 +/*
-+ *** SVE Floating Point Unary Operations - Unpredicated Group
++ * CBUS three-pin bus and the Retu / Betty / Tahvo / Vilma / Avilma /
 + * Hinku / Vinku / Ahne / Pihi chips used in various Nokia platforms.
 + * Based on reverse-engineering of a linux driver.
 + *
 + * Copyright (C) 2008 Nokia Corporation
 + * Written by Andrzej Zaborowski
 + *
 + * This work is licensed under the terms of the GNU GPL, version 2 or later.
 + * See the COPYING file in the top-level directory.
 + */
 +
-+static void do_zz_fp(DisasContext *s, arg_rr_esz *a, gen_helper_gvec_2_ptr *fn)
++#ifndef HW_MISC_CBUS_H
-+{
++#define HW_MISC_CBUS_H
 +    unsigned vsz = vec_full_reg_size(s);
 +    TCGv_ptr status = get_fpstatus_ptr(a->esz == MO_16);
 +
-+    tcg_gen_gvec_2_ptr(vec_full_reg_offset(s, a->rd),
++#include "hw/irq.h"
 +                       vec_full_reg_offset(s, a->rn),
 +                       status, vsz, vsz, 0, fn);
 +    tcg_temp_free_ptr(status);
 +}
 +
-+static bool trans_FRECPE(DisasContext *s, arg_rr_esz *a, uint32_t insn)
++typedef struct {
-+{
++    qemu_irq clk;
-+    static gen_helper_gvec_2_ptr * const fns[3] = {
++    qemu_irq dat;
-+        gen_helper_gvec_frecpe_h,
++    qemu_irq sel;
-+        gen_helper_gvec_frecpe_s,
++} CBus;
 +        gen_helper_gvec_frecpe_d,
 +    };
 +    if (a->esz == 0) {
 +        return false;
 +    }
 +    if (sve_access_check(s)) {
 +        do_zz_fp(s, a, fns[a->esz - 1]);
 +    }
 +    return true;
 +}
 +
-+static bool trans_FRSQRTE(DisasContext *s, arg_rr_esz *a, uint32_t insn)
++CBus *cbus_init(qemu_irq dat_out);
-+{
++void cbus_attach(CBus *bus, void *slave_opaque);
 +    static gen_helper_gvec_2_ptr * const fns[3] = {
 +        gen_helper_gvec_frsqrte_h,
 +        gen_helper_gvec_frsqrte_s,
 +        gen_helper_gvec_frsqrte_d,
 +    };
 +    if (a->esz == 0) {
 +        return false;
 +    }
 +    if (sve_access_check(s)) {
 +        do_zz_fp(s, a, fns[a->esz - 1]);
 +    }
 +    return true;
 +}
 +
- /*
++void *retu_init(qemu_irq irq, int vilma);
-  *** SVE Floating Point Accumulating Reduction Group
++void *tahvo_init(qemu_irq irq, int betty);
-  */
++
-diff --git a/target/arm/vec_helper.c b/target/arm/vec_helper.c
++void retu_key_event(void *retu, int state);
 +
 +#endif
 diff --git a/hw/arm/nseries.c b/hw/arm/nseries.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/vec_helper.c
+--- a/hw/arm/nseries.c
-+++ b/target/arm/vec_helper.c
++++ b/hw/arm/nseries.c
-@@ -XXX,XX +XXX,XX @@ void HELPER(gvec_fcmlad)(void *vd, void *vn, void *vm,
+@@ -XXX,XX +XXX,XX @@
-     clear_tail(d, opr_sz, simd_maxsz(desc));
+ #include "hw/i2c/i2c.h"
- }
+ #include "hw/devices.h"
+ #include "hw/display/blizzard.h"
-+#define DO_2OP(NAME, FUNC, TYPE) \
++#include "hw/misc/cbus.h"
-+void HELPER(NAME)(void *vd, void *vn, void *stat, uint32_t desc)  \
+ #include "hw/misc/tmp105.h"
-+{                                                                 \
+ #include "hw/block/flash.h"
-+    intptr_t i, oprsz = simd_oprsz(desc);                         \
+ #include "hw/hw.h"
-+    TYPE *d = vd, *n = vn;                                        \
+diff --git a/hw/misc/cbus.c b/hw/misc/cbus.c
 +    for (i = 0; i < oprsz / sizeof(TYPE); i++) {                  \
 +        d[i] = FUNC(n[i], stat);                                  \
 +    }                                                             \
 +}
 +
 +DO_2OP(gvec_frecpe_h, helper_recpe_f16, float16)
 +DO_2OP(gvec_frecpe_s, helper_recpe_f32, float32)
 +DO_2OP(gvec_frecpe_d, helper_recpe_f64, float64)
 +
 +DO_2OP(gvec_frsqrte_h, helper_rsqrte_f16, float16)
 +DO_2OP(gvec_frsqrte_s, helper_rsqrte_f32, float32)
 +DO_2OP(gvec_frsqrte_d, helper_rsqrte_f64, float64)
 +
 +#undef DO_2OP
 +
  /* Floating-point trigonometric starting value.
   * See the ARM ARM pseudocode function FPTrigSMul.
   */
 diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
+--- a/hw/misc/cbus.c
-+++ b/target/arm/sve.decode
++++ b/hw/misc/cbus.c
-@@ -XXX,XX +XXX,XX @@ FMINNMV         01100101 .. 000 101 001 ... ..... .....         @rd_pg_rn
+@@ -XXX,XX +XXX,XX @@
- FMAXV           01100101 .. 000 110 001 ... ..... .....         @rd_pg_rn
+ #include "qemu/osdep.h"
- FMINV           01100101 .. 000 111 001 ... ..... .....         @rd_pg_rn
+ #include "hw/hw.h"
+ #include "hw/irq.h"
-+## SVE Floating Point Unary Operations - Unpredicated Group
+-#include "hw/devices.h"
-+
++#include "hw/misc/cbus.h"
-+FRECPE          01100101 .. 001 110 001100 ..... .....          @rd_rn
+ #include "sysemu/sysemu.h"
-+FRSQRTE         01100101 .. 001 111 001100 ..... .....          @rd_rn
-+
+ //#define DEBUG
- ### SVE FP Accumulating Reduction Group
+diff --git a/MAINTAINERS b/MAINTAINERS
+index XXXXXXX..XXXXXXX 100644
- # SVE floating-point serial reduction (predicated)
+--- a/MAINTAINERS
 +++ b/MAINTAINERS
@@ -XXX,XX +XXX,XX @@ F: hw/input/tsc2005.c
  F: hw/misc/cbus.c
  F: hw/timer/twl92230.c
  F: include/hw/display/blizzard.h
 +F: include/hw/misc/cbus.h
  Palm
  M: Andrzej Zaborowski <balrogg@gmail.com>
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 25/55] target/arm: Implement SVE FP Fast Reduction Group
+[Qemu-devel] [PULL 37/42] hw/devices: Move Gamepad declarations into a new header
-From: Richard Henderson <richard.henderson@linaro.org>
+From: Philippe Mathieu-Daudé <philmd@redhat.com>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Markus Armbruster <armbru@redhat.com>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
-Message-id: 20180627043328.11531-20-richard.henderson@linaro.org
+Message-id: 20190412165416.7977-8-philmd@redhat.com
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper-sve.h    | 35 ++++++++++++++++++++++
+ include/hw/devices.h       |  3 ---
- target/arm/sve_helper.c    | 61 ++++++++++++++++++++++++++++++++++++++
+ include/hw/input/gamepad.h | 19 +++++++++++++++++++
- target/arm/translate-sve.c | 57 +++++++++++++++++++++++++++++++++++
+ hw/arm/stellaris.c         |  2 +-
- target/arm/sve.decode      |  8 +++++
+ hw/input/stellaris_input.c |  2 +-
-files changed, 161 insertions(+)
+ MAINTAINERS                |  1 +
 files changed, 22 insertions(+), 5 deletions(-)
  create mode 100644 include/hw/input/gamepad.h
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
+diff --git a/include/hw/devices.h b/include/hw/devices.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
+--- a/include/hw/devices.h
-+++ b/target/arm/helper-sve.h
++++ b/include/hw/devices.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_5(gvec_rsqrts_s, TCG_CALL_NO_RWG,
+@@ -XXX,XX +XXX,XX @@ void *tsc2005_init(qemu_irq pintdav);
- DEF_HELPER_FLAGS_5(gvec_rsqrts_d, TCG_CALL_NO_RWG,
+ uint32_t tsc2005_txrx(void *opaque, uint32_t value, int len);
-                    void, ptr, ptr, ptr, ptr, i32)
+ void tsc2005_set_transform(void *opaque, MouseTransformInfo *info);
-+DEF_HELPER_FLAGS_4(sve_faddv_h, TCG_CALL_NO_RWG,
+-/* stellaris_input.c */
-+                   i64, ptr, ptr, ptr, i32)
+-void stellaris_gamepad_init(int n, qemu_irq *irq, const int *keycode);
-+DEF_HELPER_FLAGS_4(sve_faddv_s, TCG_CALL_NO_RWG,
+-
-+                   i64, ptr, ptr, ptr, i32)
+ #endif
-+DEF_HELPER_FLAGS_4(sve_faddv_d, TCG_CALL_NO_RWG,
+diff --git a/include/hw/input/gamepad.h b/include/hw/input/gamepad.h
-+                   i64, ptr, ptr, ptr, i32)
+new file mode 100644
-+
+index XXXXXXX..XXXXXXX
-+DEF_HELPER_FLAGS_4(sve_fmaxnmv_h, TCG_CALL_NO_RWG,
+--- /dev/null
-+                   i64, ptr, ptr, ptr, i32)
++++ b/include/hw/input/gamepad.h
-+DEF_HELPER_FLAGS_4(sve_fmaxnmv_s, TCG_CALL_NO_RWG,
+@@ -XXX,XX +XXX,XX @@
-+                   i64, ptr, ptr, ptr, i32)
++/*
-+DEF_HELPER_FLAGS_4(sve_fmaxnmv_d, TCG_CALL_NO_RWG,
++ * Gamepad style buttons connected to IRQ/GPIO lines
 +                   i64, ptr, ptr, ptr, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_fminnmv_h, TCG_CALL_NO_RWG,
 +                   i64, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_4(sve_fminnmv_s, TCG_CALL_NO_RWG,
 +                   i64, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_4(sve_fminnmv_d, TCG_CALL_NO_RWG,
 +                   i64, ptr, ptr, ptr, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_fmaxv_h, TCG_CALL_NO_RWG,
 +                   i64, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_4(sve_fmaxv_s, TCG_CALL_NO_RWG,
 +                   i64, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_4(sve_fmaxv_d, TCG_CALL_NO_RWG,
 +                   i64, ptr, ptr, ptr, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_fminv_h, TCG_CALL_NO_RWG,
 +                   i64, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_4(sve_fminv_s, TCG_CALL_NO_RWG,
 +                   i64, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_4(sve_fminv_d, TCG_CALL_NO_RWG,
 +                   i64, ptr, ptr, ptr, i32)
 +
  DEF_HELPER_FLAGS_5(sve_fadda_h, TCG_CALL_NO_RWG,
                     i64, i64, ptr, ptr, ptr, i32)
  DEF_HELPER_FLAGS_5(sve_fadda_s, TCG_CALL_NO_RWG,
 diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve_helper.c
 +++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ uint32_t HELPER(sve_while)(void *vd, uint32_t count, uint32_t pred_desc)
      return predtest_ones(d, oprsz, esz_mask);
  }
 +/* Recursive reduction on a function;
 + * C.f. the ARM ARM function ReducePredicated.
 + *
-+ * While it would be possible to write this without the DATA temporary,
++ * Copyright (c) 2007 CodeSourcery.
-+ * it is much simpler to process the predicate register this way.
++ * Written by Paul Brook
-+ * The recursion is bounded to depth 7 (128 fp16 elements), so there's
++ *
-+ * little to gain with a more complex non-recursive form.
++ * This work is licensed under the terms of the GNU GPL, version 2 or later.
-+ */
++ * See the COPYING file in the top-level directory.
 +#define DO_REDUCE(NAME, TYPE, H, FUNC, IDENT)                         \
 +static TYPE NAME##_reduce(TYPE *data, float_status *status, uintptr_t n) \
 +{                                                                     \
 +    if (n == 1) {                                                     \
 +        return *data;                                                 \
 +    } else {                                                          \
 +        uintptr_t half = n / 2;                                       \
 +        TYPE lo = NAME##_reduce(data, status, half);                  \
 +        TYPE hi = NAME##_reduce(data + half, status, half);           \
 +        return TYPE##_##FUNC(lo, hi, status);                         \
 +    }                                                                 \
 +}                                                                     \
 +uint64_t HELPER(NAME)(void *vn, void *vg, void *vs, uint32_t desc)    \
 +{                                                                     \
 +    uintptr_t i, oprsz = simd_oprsz(desc), maxsz = simd_maxsz(desc);  \
 +    TYPE data[sizeof(ARMVectorReg) / sizeof(TYPE)];                   \
 +    for (i = 0; i < oprsz; ) {                                        \
 +        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));               \
 +        do {                                                          \
 +            TYPE nn = *(TYPE *)(vn + H(i));                           \
 +            *(TYPE *)((void *)data + i) = (pg & 1 ? nn : IDENT);      \
 +            i += sizeof(TYPE), pg >>= sizeof(TYPE);                   \
 +        } while (i & 15);                                             \
 +    }                                                                 \
 +    for (; i < maxsz; i += sizeof(TYPE)) {                            \
 +        *(TYPE *)((void *)data + i) = IDENT;                          \
 +    }                                                                 \
 +    return NAME##_reduce(data, vs, maxsz / sizeof(TYPE));             \
 +}
 +
 +DO_REDUCE(sve_faddv_h, float16, H1_2, add, float16_zero)
 +DO_REDUCE(sve_faddv_s, float32, H1_4, add, float32_zero)
 +DO_REDUCE(sve_faddv_d, float64,     , add, float64_zero)
 +
 +/* Identity is floatN_default_nan, without the function call.  */
 +DO_REDUCE(sve_fminnmv_h, float16, H1_2, minnum, 0x7E00)
 +DO_REDUCE(sve_fminnmv_s, float32, H1_4, minnum, 0x7FC00000)
 +DO_REDUCE(sve_fminnmv_d, float64,     , minnum, 0x7FF8000000000000ULL)
 +
 +DO_REDUCE(sve_fmaxnmv_h, float16, H1_2, maxnum, 0x7E00)
 +DO_REDUCE(sve_fmaxnmv_s, float32, H1_4, maxnum, 0x7FC00000)
 +DO_REDUCE(sve_fmaxnmv_d, float64,     , maxnum, 0x7FF8000000000000ULL)
 +
 +DO_REDUCE(sve_fminv_h, float16, H1_2, min, float16_infinity)
 +DO_REDUCE(sve_fminv_s, float32, H1_4, min, float32_infinity)
 +DO_REDUCE(sve_fminv_d, float64,     , min, float64_infinity)
 +
 +DO_REDUCE(sve_fmaxv_h, float16, H1_2, max, float16_chs(float16_infinity))
 +DO_REDUCE(sve_fmaxv_s, float32, H1_4, max, float32_chs(float32_infinity))
 +DO_REDUCE(sve_fmaxv_d, float64,     , max, float64_chs(float64_infinity))
 +
 +#undef DO_REDUCE
 +
  uint64_t HELPER(sve_fadda_h)(uint64_t nn, void *vm, void *vg,
                               void *status, uint32_t desc)
  {
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-sve.c
 +++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_FMUL_zzx(DisasContext *s, arg_FMUL_zzx *a, uint32_t insn)
      return true;
  }
 +/*
 + *** SVE Floating Point Fast Reduction Group
 + */
 +
-+typedef void gen_helper_fp_reduce(TCGv_i64, TCGv_ptr, TCGv_ptr,
++#ifndef HW_INPUT_GAMEPAD_H
-+                                  TCGv_ptr, TCGv_i32);
++#define HW_INPUT_GAMEPAD_H
 +
-+static void do_reduce(DisasContext *s, arg_rpr_esz *a,
++#include "hw/irq.h"
 +                      gen_helper_fp_reduce *fn)
 +{
 +    unsigned vsz = vec_full_reg_size(s);
 +    unsigned p2vsz = pow2ceil(vsz);
 +    TCGv_i32 t_desc = tcg_const_i32(simd_desc(vsz, p2vsz, 0));
 +    TCGv_ptr t_zn, t_pg, status;
 +    TCGv_i64 temp;
 +
-+    temp = tcg_temp_new_i64();
++/* stellaris_input.c */
-+    t_zn = tcg_temp_new_ptr();
++void stellaris_gamepad_init(int n, qemu_irq *irq, const int *keycode);
 +    t_pg = tcg_temp_new_ptr();
 +
-+    tcg_gen_addi_ptr(t_zn, cpu_env, vec_full_reg_offset(s, a->rn));
++#endif
-+    tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, a->pg));
+diff --git a/hw/arm/stellaris.c b/hw/arm/stellaris.c
-+    status = get_fpstatus_ptr(a->esz == MO_16);
+index XXXXXXX..XXXXXXX 100644
-+
+--- a/hw/arm/stellaris.c
-+    fn(temp, t_zn, t_pg, status, t_desc);
++++ b/hw/arm/stellaris.c
-+    tcg_temp_free_ptr(t_zn);
+@@ -XXX,XX +XXX,XX @@
-+    tcg_temp_free_ptr(t_pg);
+ #include "hw/sysbus.h"
-+    tcg_temp_free_ptr(status);
+ #include "hw/ssi/ssi.h"
-+    tcg_temp_free_i32(t_desc);
+ #include "hw/arm/arm.h"
-+
+-#include "hw/devices.h"
-+    write_fp_dreg(s, a->rd, temp);
+ #include "qemu/timer.h"
-+    tcg_temp_free_i64(temp);
+ #include "hw/i2c/i2c.h"
-+}
+ #include "net/net.h"
-+
+@@ -XXX,XX +XXX,XX @@
-+#define DO_VPZ(NAME, name) \
+ #include "sysemu/sysemu.h"
-+static bool trans_##NAME(DisasContext *s, arg_rpr_esz *a, uint32_t insn) \
+ #include "hw/arm/armv7m.h"
-+{                                                                        \
+ #include "hw/char/pl011.h"
-+    static gen_helper_fp_reduce * const fns[3] = {                       \
++#include "hw/input/gamepad.h"
-+        gen_helper_sve_##name##_h,                                       \
+ #include "hw/watchdog/cmsdk-apb-watchdog.h"
-+        gen_helper_sve_##name##_s,                                       \
+ #include "hw/misc/unimp.h"
-+        gen_helper_sve_##name##_d,                                       \
+ #include "cpu.h"
-+    };                                                                   \
+diff --git a/hw/input/stellaris_input.c b/hw/input/stellaris_input.c
-+    if (a->esz == 0) {                                                   \
+index XXXXXXX..XXXXXXX 100644
-+        return false;                                                    \
+--- a/hw/input/stellaris_input.c
-+    }                                                                    \
++++ b/hw/input/stellaris_input.c
-+    if (sve_access_check(s)) {                                           \
+@@ -XXX,XX +XXX,XX @@
 +        do_reduce(s, a, fns[a->esz - 1]);                                \
 +    }                                                                    \
 +    return true;                                                         \
 +}
 +
 +DO_VPZ(FADDV, faddv)
 +DO_VPZ(FMINNMV, fminnmv)
 +DO_VPZ(FMAXNMV, fmaxnmv)
 +DO_VPZ(FMINV, fminv)
 +DO_VPZ(FMAXV, fmaxv)
 +
  /*
   *** SVE Floating Point Accumulating Reduction Group
   */
-diff --git a/target/arm/sve.decode b/target/arm/sve.decode
+ #include "qemu/osdep.h"
  #include "hw/hw.h"
 -#include "hw/devices.h"
 +#include "hw/input/gamepad.h"
  #include "ui/console.h"
  typedef struct {
 diff --git a/MAINTAINERS b/MAINTAINERS
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
+--- a/MAINTAINERS
-+++ b/target/arm/sve.decode
++++ b/MAINTAINERS
-@@ -XXX,XX +XXX,XX @@ FMUL_zzx        01100100 0.1 .. rm:3 001000 rn:5 rd:5 \
+@@ -XXX,XX +XXX,XX @@ M: Peter Maydell <peter.maydell@linaro.org>
- FMUL_zzx        01100100 101 index:2 rm:3 001000 rn:5 rd:5      esz=2
+ L: qemu-arm@nongnu.org
- FMUL_zzx        01100100 111 index:1 rm:4 001000 rn:5 rd:5      esz=3
+ S: Maintained
+ F: hw/*/stellaris*
-+### SVE FP Fast Reduction Group
++F: include/hw/input/gamepad.h
-+
-+FADDV           01100101 .. 000 000 001 ... ..... .....         @rd_pg_rn
+ Versatile Express
-+FMAXNMV         01100101 .. 000 100 001 ... ..... .....         @rd_pg_rn
+ M: Peter Maydell <peter.maydell@linaro.org>
 +FMINNMV         01100101 .. 000 101 001 ... ..... .....         @rd_pg_rn
 +FMAXV           01100101 .. 000 110 001 ... ..... .....         @rd_pg_rn
 +FMINV           01100101 .. 000 111 001 ... ..... .....         @rd_pg_rn
 +
  ### SVE FP Accumulating Reduction Group
  # SVE floating-point serial reduction (predicated)
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 17/55] target/arm: Implement SVE scatter stores
+[Qemu-devel] [PULL 38/42] hw/devices: Move TI touchscreen declarations into a new header
-From: Richard Henderson <richard.henderson@linaro.org>
+From: Philippe Mathieu-Daudé <philmd@redhat.com>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Since uWireSlave is only used in this new header, there is no
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+need to expose it via "qemu/typedefs.h".
-Message-id: 20180627043328.11531-12-richard.henderson@linaro.org
 Reviewed-by: Markus Armbruster <armbru@redhat.com>
 Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Message-id: 20190412165416.7977-9-philmd@redhat.com
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper-sve.h    | 41 +++++++++++++++++++++
+ include/hw/arm/omap.h      |  6 +-----
- target/arm/sve_helper.c    | 61 +++++++++++++++++++++++++++++++
+ include/hw/devices.h       | 15 ---------------
- target/arm/translate-sve.c | 75 ++++++++++++++++++++++++++++++++++++++
+ include/hw/input/tsc2xxx.h | 36 ++++++++++++++++++++++++++++++++++++
- target/arm/sve.decode      | 39 ++++++++++++++++++++
+ include/qemu/typedefs.h    |  1 -
-files changed, 216 insertions(+)
+ hw/arm/nseries.c           |  2 +-
+ hw/arm/palm.c              |  2 +-
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
+ hw/input/tsc2005.c         |  2 +-
-index XXXXXXX..XXXXXXX 100644
+ hw/input/tsc210x.c         |  4 ++--
---- a/target/arm/helper-sve.h
+ MAINTAINERS                |  2 ++
-+++ b/target/arm/helper-sve.h
+files changed, 44 insertions(+), 26 deletions(-)
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_4(sve_st1hs_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+ create mode 100644 include/hw/input/tsc2xxx.h
- DEF_HELPER_FLAGS_4(sve_st1hd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+diff --git a/include/hw/arm/omap.h b/include/hw/arm/omap.h
- DEF_HELPER_FLAGS_4(sve_st1sd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+index XXXXXXX..XXXXXXX 100644
-+
+--- a/include/hw/arm/omap.h
-+DEF_HELPER_FLAGS_6(sve_stbs_zsu, TCG_CALL_NO_WG,
++++ b/include/hw/arm/omap.h
-+                   void, env, ptr, ptr, ptr, tl, i32)
+@@ -XXX,XX +XXX,XX @@
-+DEF_HELPER_FLAGS_6(sve_sths_zsu, TCG_CALL_NO_WG,
+ #include "exec/memory.h"
-+                   void, env, ptr, ptr, ptr, tl, i32)
+ # define hw_omap_h        "omap.h"
-+DEF_HELPER_FLAGS_6(sve_stss_zsu, TCG_CALL_NO_WG,
+ #include "hw/irq.h"
-+                   void, env, ptr, ptr, ptr, tl, i32)
++#include "hw/input/tsc2xxx.h"
-+
+ #include "target/arm/cpu-qom.h"
-+DEF_HELPER_FLAGS_6(sve_stbs_zss, TCG_CALL_NO_WG,
+ #include "qemu/log.h"
-+                   void, env, ptr, ptr, ptr, tl, i32)
-+DEF_HELPER_FLAGS_6(sve_sths_zss, TCG_CALL_NO_WG,
+@@ -XXX,XX +XXX,XX @@ qemu_irq *omap_mpuio_in_get(struct omap_mpuio_s *s);
-+                   void, env, ptr, ptr, ptr, tl, i32)
+ void omap_mpuio_out_set(struct omap_mpuio_s *s, int line, qemu_irq handler);
-+DEF_HELPER_FLAGS_6(sve_stss_zss, TCG_CALL_NO_WG,
+ void omap_mpuio_key(struct omap_mpuio_s *s, int row, int col, int down);
-+                   void, env, ptr, ptr, ptr, tl, i32)
-+
+-struct uWireSlave {
-+DEF_HELPER_FLAGS_6(sve_stbd_zsu, TCG_CALL_NO_WG,
+-    uint16_t (*receive)(void *opaque);
-+                   void, env, ptr, ptr, ptr, tl, i32)
+-    void (*send)(void *opaque, uint16_t data);
-+DEF_HELPER_FLAGS_6(sve_sthd_zsu, TCG_CALL_NO_WG,
+-    void *opaque;
-+                   void, env, ptr, ptr, ptr, tl, i32)
+-};
-+DEF_HELPER_FLAGS_6(sve_stsd_zsu, TCG_CALL_NO_WG,
+ struct omap_uwire_s;
-+                   void, env, ptr, ptr, ptr, tl, i32)
+ void omap_uwire_attach(struct omap_uwire_s *s,
-+DEF_HELPER_FLAGS_6(sve_stdd_zsu, TCG_CALL_NO_WG,
+                 uWireSlave *slave, int chipselect);
-+                   void, env, ptr, ptr, ptr, tl, i32)
+diff --git a/include/hw/devices.h b/include/hw/devices.h
-+
+index XXXXXXX..XXXXXXX 100644
-+DEF_HELPER_FLAGS_6(sve_stbd_zss, TCG_CALL_NO_WG,
+--- a/include/hw/devices.h
-+                   void, env, ptr, ptr, ptr, tl, i32)
++++ b/include/hw/devices.h
-+DEF_HELPER_FLAGS_6(sve_sthd_zss, TCG_CALL_NO_WG,
+@@ -XXX,XX +XXX,XX @@
-+                   void, env, ptr, ptr, ptr, tl, i32)
+ /* Devices that have nowhere better to go.  */
-+DEF_HELPER_FLAGS_6(sve_stsd_zss, TCG_CALL_NO_WG,
-+                   void, env, ptr, ptr, ptr, tl, i32)
+ #include "hw/hw.h"
-+DEF_HELPER_FLAGS_6(sve_stdd_zss, TCG_CALL_NO_WG,
+-#include "ui/console.h"
-+                   void, env, ptr, ptr, ptr, tl, i32)
-+
+ /* smc91c111.c */
-+DEF_HELPER_FLAGS_6(sve_stbd_zd, TCG_CALL_NO_WG,
+ void smc91c111_init(NICInfo *, uint32_t, qemu_irq);
-+                   void, env, ptr, ptr, ptr, tl, i32)
+@@ -XXX,XX +XXX,XX @@ void smc91c111_init(NICInfo *, uint32_t, qemu_irq);
-+DEF_HELPER_FLAGS_6(sve_sthd_zd, TCG_CALL_NO_WG,
+ /* lan9118.c */
-+                   void, env, ptr, ptr, ptr, tl, i32)
+ void lan9118_init(NICInfo *, uint32_t, qemu_irq);
-+DEF_HELPER_FLAGS_6(sve_stsd_zd, TCG_CALL_NO_WG,
-+                   void, env, ptr, ptr, ptr, tl, i32)
+-/* tsc210x.c */
-+DEF_HELPER_FLAGS_6(sve_stdd_zd, TCG_CALL_NO_WG,
+-uWireSlave *tsc2102_init(qemu_irq pint);
-+                   void, env, ptr, ptr, ptr, tl, i32)
+-uWireSlave *tsc2301_init(qemu_irq penirq, qemu_irq kbirq, qemu_irq dav);
-diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
+-I2SCodec *tsc210x_codec(uWireSlave *chip);
-index XXXXXXX..XXXXXXX 100644
+-uint32_t tsc210x_txrx(void *opaque, uint32_t value, int len);
---- a/target/arm/sve_helper.c
+-void tsc210x_set_transform(uWireSlave *chip,
-+++ b/target/arm/sve_helper.c
+-                MouseTransformInfo *info);
-@@ -XXX,XX +XXX,XX @@ void HELPER(sve_st4dd_r)(CPUARMState *env, void *vg,
+-void tsc210x_key_event(uWireSlave *chip, int key, int down);
-         addr += 4 * 8;
+-
-     }
+-/* tsc2005.c */
- }
+-void *tsc2005_init(qemu_irq pintdav);
-+
+-uint32_t tsc2005_txrx(void *opaque, uint32_t value, int len);
-+/* Stores with a vector index.  */
+-void tsc2005_set_transform(void *opaque, MouseTransformInfo *info);
-+
+-
-+#define DO_ST1_ZPZ_S(NAME, TYPEI, FN)                                   \
+ #endif
-+void HELPER(NAME)(CPUARMState *env, void *vd, void *vg, void *vm,       \
+diff --git a/include/hw/input/tsc2xxx.h b/include/hw/input/tsc2xxx.h
-+                  target_ulong base, uint32_t desc)                     \
+new file mode 100644
-+{                                                                       \
+index XXXXXXX..XXXXXXX
-+    intptr_t i, oprsz = simd_oprsz(desc);                               \
+--- /dev/null
-+    unsigned scale = simd_data(desc);                                   \
++++ b/include/hw/input/tsc2xxx.h
-+    uintptr_t ra = GETPC();                                             \
+@@ -XXX,XX +XXX,XX @@
 +    for (i = 0; i < oprsz; ) {                                          \
 +        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));                 \
 +        do {                                                            \
 +            if (likely(pg & 1)) {                                       \
 +                target_ulong off = *(TYPEI *)(vm + H1_4(i));            \
 +                uint32_t d = *(uint32_t *)(vd + H1_4(i));               \
 +                FN(env, base + (off << scale), d, ra);                  \
 +            }                                                           \
 +            i += sizeof(uint32_t), pg >>= sizeof(uint32_t);             \
 +        } while (i & 15);                                               \
 +    }                                                                   \
 +}
 +
 +#define DO_ST1_ZPZ_D(NAME, TYPEI, FN)                                   \
 +void HELPER(NAME)(CPUARMState *env, void *vd, void *vg, void *vm,       \
 +                  target_ulong base, uint32_t desc)                     \
 +{                                                                       \
 +    intptr_t i, oprsz = simd_oprsz(desc) / 8;                           \
 +    unsigned scale = simd_data(desc);                                   \
 +    uintptr_t ra = GETPC();                                             \
 +    uint64_t *d = vd, *m = vm; uint8_t *pg = vg;                        \
 +    for (i = 0; i < oprsz; i++) {                                       \
 +        if (likely(pg[H1(i)] & 1)) {                                    \
 +            target_ulong off = (target_ulong)(TYPEI)m[i] << scale;      \
 +            FN(env, base + off, d[i], ra);                              \
 +        }                                                               \
 +    }                                                                   \
 +}
 +
 +DO_ST1_ZPZ_S(sve_stbs_zsu, uint32_t, cpu_stb_data_ra)
 +DO_ST1_ZPZ_S(sve_sths_zsu, uint32_t, cpu_stw_data_ra)
 +DO_ST1_ZPZ_S(sve_stss_zsu, uint32_t, cpu_stl_data_ra)
 +
 +DO_ST1_ZPZ_S(sve_stbs_zss, int32_t, cpu_stb_data_ra)
 +DO_ST1_ZPZ_S(sve_sths_zss, int32_t, cpu_stw_data_ra)
 +DO_ST1_ZPZ_S(sve_stss_zss, int32_t, cpu_stl_data_ra)
 +
 +DO_ST1_ZPZ_D(sve_stbd_zsu, uint32_t, cpu_stb_data_ra)
 +DO_ST1_ZPZ_D(sve_sthd_zsu, uint32_t, cpu_stw_data_ra)
 +DO_ST1_ZPZ_D(sve_stsd_zsu, uint32_t, cpu_stl_data_ra)
 +DO_ST1_ZPZ_D(sve_stdd_zsu, uint32_t, cpu_stq_data_ra)
 +
 +DO_ST1_ZPZ_D(sve_stbd_zss, int32_t, cpu_stb_data_ra)
 +DO_ST1_ZPZ_D(sve_sthd_zss, int32_t, cpu_stw_data_ra)
 +DO_ST1_ZPZ_D(sve_stsd_zss, int32_t, cpu_stl_data_ra)
 +DO_ST1_ZPZ_D(sve_stdd_zss, int32_t, cpu_stq_data_ra)
 +
 +DO_ST1_ZPZ_D(sve_stbd_zd, uint64_t, cpu_stb_data_ra)
 +DO_ST1_ZPZ_D(sve_sthd_zd, uint64_t, cpu_stw_data_ra)
 +DO_ST1_ZPZ_D(sve_stsd_zd, uint64_t, cpu_stl_data_ra)
 +DO_ST1_ZPZ_D(sve_stdd_zd, uint64_t, cpu_stq_data_ra)
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-sve.c
 +++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ typedef void gen_helper_gvec_flags_4(TCGv_i32, TCGv_ptr, TCGv_ptr,
                                       TCGv_ptr, TCGv_ptr, TCGv_i32);
  typedef void gen_helper_gvec_mem(TCGv_env, TCGv_ptr, TCGv_i64, TCGv_i32);
 +typedef void gen_helper_gvec_mem_scatter(TCGv_env, TCGv_ptr, TCGv_ptr,
 +                                         TCGv_ptr, TCGv_i64, TCGv_i32);
  /*
   * Helpers for extracting complex instruction fields.
@@ -XXX,XX +XXX,XX @@ static bool trans_ST_zpri(DisasContext *s, arg_rpri_store *a, uint32_t insn)
      }
      return true;
  }
 +
 +/*
-+ *** SVE gather loads / scatter stores
++ * TI touchscreen controller
 + *
 + * Copyright (c) 2006 Andrzej Zaborowski
 + * Copyright (C) 2008 Nokia Corporation
 + *
 + * This work is licensed under the terms of the GNU GPL, version 2 or later.
 + * See the COPYING file in the top-level directory.
 + */
 +
-+static void do_mem_zpz(DisasContext *s, int zt, int pg, int zm, int scale,
++#ifndef HW_INPUT_TSC2XXX_H
-+                       TCGv_i64 scalar, gen_helper_gvec_mem_scatter *fn)
++#define HW_INPUT_TSC2XXX_H
-+{
++
-+    unsigned vsz = vec_full_reg_size(s);
++#include "hw/irq.h"
-+    TCGv_i32 desc = tcg_const_i32(simd_desc(vsz, vsz, scale));
++#include "ui/console.h"
-+    TCGv_ptr t_zm = tcg_temp_new_ptr();
++
-+    TCGv_ptr t_pg = tcg_temp_new_ptr();
++typedef struct uWireSlave {
-+    TCGv_ptr t_zt = tcg_temp_new_ptr();
++    uint16_t (*receive)(void *opaque);
-+
++    void (*send)(void *opaque, uint16_t data);
-+    tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, pg));
++    void *opaque;
-+    tcg_gen_addi_ptr(t_zm, cpu_env, vec_full_reg_offset(s, zm));
++} uWireSlave;
-+    tcg_gen_addi_ptr(t_zt, cpu_env, vec_full_reg_offset(s, zt));
++
-+    fn(cpu_env, t_zt, t_pg, t_zm, scalar, desc);
++/* tsc210x.c */
-+
++uWireSlave *tsc2102_init(qemu_irq pint);
-+    tcg_temp_free_ptr(t_zt);
++uWireSlave *tsc2301_init(qemu_irq penirq, qemu_irq kbirq, qemu_irq dav);
-+    tcg_temp_free_ptr(t_zm);
++I2SCodec *tsc210x_codec(uWireSlave *chip);
-+    tcg_temp_free_ptr(t_pg);
++uint32_t tsc210x_txrx(void *opaque, uint32_t value, int len);
-+    tcg_temp_free_i32(desc);
++void tsc210x_set_transform(uWireSlave *chip, MouseTransformInfo *info);
-+}
++void tsc210x_key_event(uWireSlave *chip, int key, int down);
 +
-+static bool trans_ST1_zprz(DisasContext *s, arg_ST1_zprz *a, uint32_t insn)
++/* tsc2005.c */
-+{
++void *tsc2005_init(qemu_irq pintdav);
-+    /* Indexed by [xs][msz].  */
++uint32_t tsc2005_txrx(void *opaque, uint32_t value, int len);
-+    static gen_helper_gvec_mem_scatter * const fn32[2][3] = {
++void tsc2005_set_transform(void *opaque, MouseTransformInfo *info);
-+        { gen_helper_sve_stbs_zsu,
++
-+          gen_helper_sve_sths_zsu,
++#endif
-+          gen_helper_sve_stss_zsu, },
+diff --git a/include/qemu/typedefs.h b/include/qemu/typedefs.h
-+        { gen_helper_sve_stbs_zss,
+index XXXXXXX..XXXXXXX 100644
-+          gen_helper_sve_sths_zss,
+--- a/include/qemu/typedefs.h
-+          gen_helper_sve_stss_zss, },
++++ b/include/qemu/typedefs.h
-+    };
+@@ -XXX,XX +XXX,XX @@ typedef struct RAMBlock RAMBlock;
-+    /* Note that we overload xs=2 to indicate 64-bit offset.  */
+ typedef struct Range Range;
-+    static gen_helper_gvec_mem_scatter * const fn64[3][4] = {
+ typedef struct SHPCDevice SHPCDevice;
-+        { gen_helper_sve_stbd_zsu,
+ typedef struct SSIBus SSIBus;
-+          gen_helper_sve_sthd_zsu,
+-typedef struct uWireSlave uWireSlave;
-+          gen_helper_sve_stsd_zsu,
+ typedef struct VirtIODevice VirtIODevice;
-+          gen_helper_sve_stdd_zsu, },
+ typedef struct Visitor Visitor;
-+        { gen_helper_sve_stbd_zss,
+ typedef void SaveStateHandler(QEMUFile *f, void *opaque);
-+          gen_helper_sve_sthd_zss,
+diff --git a/hw/arm/nseries.c b/hw/arm/nseries.c
-+          gen_helper_sve_stsd_zss,
+index XXXXXXX..XXXXXXX 100644
-+          gen_helper_sve_stdd_zss, },
+--- a/hw/arm/nseries.c
-+        { gen_helper_sve_stbd_zd,
++++ b/hw/arm/nseries.c
-+          gen_helper_sve_sthd_zd,
+@@ -XXX,XX +XXX,XX @@
-+          gen_helper_sve_stsd_zd,
+ #include "ui/console.h"
-+          gen_helper_sve_stdd_zd, },
+ #include "hw/boards.h"
-+    };
+ #include "hw/i2c/i2c.h"
-+    gen_helper_gvec_mem_scatter *fn;
+-#include "hw/devices.h"
-+
+ #include "hw/display/blizzard.h"
-+    if (a->esz < a->msz || (a->msz == 0 && a->scale)) {
++#include "hw/input/tsc2xxx.h"
-+        return false;
+ #include "hw/misc/cbus.h"
-+    }
+ #include "hw/misc/tmp105.h"
-+    if (!sve_access_check(s)) {
+ #include "hw/block/flash.h"
-+        return true;
+diff --git a/hw/arm/palm.c b/hw/arm/palm.c
-+    }
+index XXXXXXX..XXXXXXX 100644
-+    switch (a->esz) {
+--- a/hw/arm/palm.c
-+    case MO_32:
++++ b/hw/arm/palm.c
-+        fn = fn32[a->xs][a->msz];
+@@ -XXX,XX +XXX,XX @@
-+        break;
+ #include "hw/arm/omap.h"
-+    case MO_64:
+ #include "hw/boards.h"
-+        fn = fn64[a->xs][a->msz];
+ #include "hw/arm/arm.h"
-+        break;
+-#include "hw/devices.h"
-+    default:
++#include "hw/input/tsc2xxx.h"
-+        g_assert_not_reached();
+ #include "hw/loader.h"
-+    }
+ #include "exec/address-spaces.h"
-+    do_mem_zpz(s, a->rd, a->pg, a->rm, a->scale * a->msz,
+ #include "cpu.h"
-+               cpu_reg_sp(s, a->rn), fn);
+diff --git a/hw/input/tsc2005.c b/hw/input/tsc2005.c
-+    return true;
+index XXXXXXX..XXXXXXX 100644
-+}
+--- a/hw/input/tsc2005.c
-diff --git a/target/arm/sve.decode b/target/arm/sve.decode
++++ b/hw/input/tsc2005.c
-index XXXXXXX..XXXXXXX 100644
+@@ -XXX,XX +XXX,XX @@
---- a/target/arm/sve.decode
+ #include "hw/hw.h"
-+++ b/target/arm/sve.decode
+ #include "qemu/timer.h"
-@@ -XXX,XX +XXX,XX @@
+ #include "ui/console.h"
- &rpri_load      rd pg rn imm dtype nreg
+-#include "hw/devices.h"
- &rprr_store     rd pg rn rm msz esz nreg
++#include "hw/input/tsc2xxx.h"
- &rpri_store     rd pg rn imm msz esz nreg
+ #include "trace.h"
-+&rprr_scatter_store     rd pg rn rm esz msz xs scale
+ #define TSC_CUT_RESOLUTION(value, p)    ((value) >> (16 - (p ? 12 : 10)))
- ###########################################################################
+diff --git a/hw/input/tsc210x.c b/hw/input/tsc210x.c
- # Named instruction formats.  These are generally used to
+index XXXXXXX..XXXXXXX 100644
-@@ -XXX,XX +XXX,XX @@
+--- a/hw/input/tsc210x.c
- @rpri_store_msz     ....... msz:2 .. . imm:s4 ... pg:3 rn:5 rd:5    &rpri_store
++++ b/hw/input/tsc210x.c
- @rprr_store_esz_n0  ....... ..    esz:2  rm:5 ... pg:3 rn:5 rd:5 \
+@@ -XXX,XX +XXX,XX @@
-                     &rprr_store nreg=0
+ #include "audio/audio.h"
-+@rprr_scatter_store ....... msz:2 ..     rm:5 ... pg:3 rn:5 rd:5 \
+ #include "qemu/timer.h"
-+                    &rprr_scatter_store
+ #include "ui/console.h"
+-#include "hw/arm/omap.h"    /* For I2SCodec and uWireSlave */
- ###########################################################################
+-#include "hw/devices.h"
- # Instruction patterns.  Grouped according to the SVE encodingindex.xhtml.
++#include "hw/arm/omap.h"            /* For I2SCodec */
-@@ -XXX,XX +XXX,XX @@ ST_zpri         1110010 .. nreg:2 1.... 111 ... ..... ..... \
++#include "hw/input/tsc2xxx.h"
- # SVE store multiple structures (scalar plus scalar)         (nreg != 0)
- ST_zprr         1110010 msz:2 nreg:2 ..... 011 ... ..... ..... \
+ #define TSC_DATA_REGISTERS_PAGE        0x0
-                 @rprr_store esz=%size_23
+ #define TSC_CONTROL_REGISTERS_PAGE    0x1
-+
+diff --git a/MAINTAINERS b/MAINTAINERS
-+# SVE 32-bit scatter store (scalar plus 32-bit scaled offsets)
+index XXXXXXX..XXXXXXX 100644
-+# Require msz > 0 && msz <= esz.
+--- a/MAINTAINERS
-+ST1_zprz        1110010 .. 11 ..... 100 ... ..... ..... \
++++ b/MAINTAINERS
-+                @rprr_scatter_store xs=0 esz=2 scale=1
+@@ -XXX,XX +XXX,XX @@ F: hw/input/tsc2005.c
-+ST1_zprz        1110010 .. 11 ..... 110 ... ..... ..... \
+ F: hw/misc/cbus.c
-+                @rprr_scatter_store xs=1 esz=2 scale=1
+ F: hw/timer/twl92230.c
-+
+ F: include/hw/display/blizzard.h
-+# SVE 32-bit scatter store (scalar plus 32-bit unscaled offsets)
++F: include/hw/input/tsc2xxx.h
-+# Require msz <= esz.
+ F: include/hw/misc/cbus.h
-+ST1_zprz        1110010 .. 10 ..... 100 ... ..... ..... \
-+                @rprr_scatter_store xs=0 esz=2 scale=0
+ Palm
-+ST1_zprz        1110010 .. 10 ..... 110 ... ..... ..... \
+@@ -XXX,XX +XXX,XX @@ L: qemu-arm@nongnu.org
-+                @rprr_scatter_store xs=1 esz=2 scale=0
+ S: Odd Fixes
-+
+ F: hw/arm/palm.c
-+# SVE 64-bit scatter store (scalar plus 64-bit scaled offset)
+ F: hw/input/tsc210x.c
-+# Require msz > 0
++F: include/hw/input/tsc2xxx.h
-+ST1_zprz        1110010 .. 01 ..... 101 ... ..... ..... \
-+                @rprr_scatter_store xs=2 esz=3 scale=1
+ Raspberry Pi
-+
+ M: Peter Maydell <peter.maydell@linaro.org>
 +# SVE 64-bit scatter store (scalar plus 64-bit unscaled offset)
 +ST1_zprz        1110010 .. 00 ..... 101 ... ..... ..... \
 +                @rprr_scatter_store xs=2 esz=3 scale=0
 +
 +# SVE 64-bit scatter store (scalar plus unpacked 32-bit scaled offset)
 +# Require msz > 0
 +ST1_zprz        1110010 .. 01 ..... 100 ... ..... ..... \
 +                @rprr_scatter_store xs=0 esz=3 scale=1
 +ST1_zprz        1110010 .. 01 ..... 110 ... ..... ..... \
 +                @rprr_scatter_store xs=1 esz=3 scale=1
 +
 +# SVE 64-bit scatter store (scalar plus unpacked 32-bit unscaled offset)
 +ST1_zprz        1110010 .. 00 ..... 100 ... ..... ..... \
 +                @rprr_scatter_store xs=0 esz=3 scale=0
 +ST1_zprz        1110010 .. 00 ..... 110 ... ..... ..... \
 +                @rprr_scatter_store xs=1 esz=3 scale=0
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 24/55] target/arm: Implement SVE Floating Point Multiply Indexed Group
+[Qemu-devel] [PULL 39/42] hw/devices: Move LAN9118 declarations into a new header
-From: Richard Henderson <richard.henderson@linaro.org>
+From: Philippe Mathieu-Daudé <philmd@redhat.com>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Markus Armbruster <armbru@redhat.com>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
-Message-id: 20180627043328.11531-19-richard.henderson@linaro.org
+Message-id: 20190412165416.7977-10-philmd@redhat.com
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper.h        | 14 +++++++++++
+ include/hw/devices.h     |  3 ---
- target/arm/translate-sve.c | 50 ++++++++++++++++++++++++++++++++++++++
+ include/hw/net/lan9118.h | 19 +++++++++++++++++++
- target/arm/vec_helper.c    | 48 ++++++++++++++++++++++++++++++++++++
+ hw/arm/kzm.c             |  2 +-
- target/arm/sve.decode      | 19 +++++++++++++++
+ hw/arm/mps2.c            |  2 +-
-files changed, 131 insertions(+)
+ hw/arm/realview.c        |  1 +
  hw/arm/vexpress.c        |  2 +-
  hw/net/lan9118.c         |  2 +-
 files changed, 24 insertions(+), 7 deletions(-)
  create mode 100644 include/hw/net/lan9118.h
-diff --git a/target/arm/helper.h b/target/arm/helper.h
+diff --git a/include/hw/devices.h b/include/hw/devices.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper.h
+--- a/include/hw/devices.h
-+++ b/target/arm/helper.h
++++ b/include/hw/devices.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_5(gvec_ftsmul_s, TCG_CALL_NO_RWG,
+@@ -XXX,XX +XXX,XX @@
- DEF_HELPER_FLAGS_5(gvec_ftsmul_d, TCG_CALL_NO_RWG,
+ /* smc91c111.c */
-                    void, ptr, ptr, ptr, ptr, i32)
+ void smc91c111_init(NICInfo *, uint32_t, qemu_irq);
-+DEF_HELPER_FLAGS_5(gvec_fmul_idx_h, TCG_CALL_NO_RWG,
+-/* lan9118.c */
-+                   void, ptr, ptr, ptr, ptr, i32)
+-void lan9118_init(NICInfo *, uint32_t, qemu_irq);
-+DEF_HELPER_FLAGS_5(gvec_fmul_idx_s, TCG_CALL_NO_RWG,
+-
-+                   void, ptr, ptr, ptr, ptr, i32)
+ #endif
-+DEF_HELPER_FLAGS_5(gvec_fmul_idx_d, TCG_CALL_NO_RWG,
+diff --git a/include/hw/net/lan9118.h b/include/hw/net/lan9118.h
-+                   void, ptr, ptr, ptr, ptr, i32)
+new file mode 100644
-+
+index XXXXXXX..XXXXXXX
-+DEF_HELPER_FLAGS_6(gvec_fmla_idx_h, TCG_CALL_NO_RWG,
+--- /dev/null
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
++++ b/include/hw/net/lan9118.h
-+DEF_HELPER_FLAGS_6(gvec_fmla_idx_s, TCG_CALL_NO_RWG,
+@@ -XXX,XX +XXX,XX @@
 +                   void, ptr, ptr, ptr, ptr, ptr, i32)
 +DEF_HELPER_FLAGS_6(gvec_fmla_idx_d, TCG_CALL_NO_RWG,
 +                   void, ptr, ptr, ptr, ptr, ptr, i32)
 +
  #ifdef TARGET_AARCH64
  #include "helper-a64.h"
  #include "helper-sve.h"
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/translate-sve.c
 +++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ DO_ZZI(UMIN, umin)
  #undef DO_ZZI
 +/*
-+ *** SVE Floating Point Multiply-Add Indexed Group
++ * SMSC LAN9118 Ethernet interface emulation
 + *
 + * Copyright (c) 2009 CodeSourcery, LLC.
 + * Written by Paul Brook
 + *
 + * This work is licensed under the terms of the GNU GPL, version 2 or later.
 + * See the COPYING file in the top-level directory.
 + */
 +
-+static bool trans_FMLA_zzxz(DisasContext *s, arg_FMLA_zzxz *a, uint32_t insn)
++#ifndef HW_NET_LAN9118_H
-+{
++#define HW_NET_LAN9118_H
 +    static gen_helper_gvec_4_ptr * const fns[3] = {
 +        gen_helper_gvec_fmla_idx_h,
 +        gen_helper_gvec_fmla_idx_s,
 +        gen_helper_gvec_fmla_idx_d,
 +    };
 +
-+    if (sve_access_check(s)) {
++#include "hw/irq.h"
-+        unsigned vsz = vec_full_reg_size(s);
++#include "net/net.h"
 +        TCGv_ptr status = get_fpstatus_ptr(a->esz == MO_16);
 +        tcg_gen_gvec_4_ptr(vec_full_reg_offset(s, a->rd),
 +                           vec_full_reg_offset(s, a->rn),
 +                           vec_full_reg_offset(s, a->rm),
 +                           vec_full_reg_offset(s, a->ra),
 +                           status, vsz, vsz, (a->index << 1) | a->sub,
 +                           fns[a->esz - 1]);
 +        tcg_temp_free_ptr(status);
 +    }
 +    return true;
 +}
 +
-+/*
++void lan9118_init(NICInfo *, uint32_t, qemu_irq);
 + *** SVE Floating Point Multiply Indexed Group
 + */
 +
-+static bool trans_FMUL_zzx(DisasContext *s, arg_FMUL_zzx *a, uint32_t insn)
++#endif
-+{
+diff --git a/hw/arm/kzm.c b/hw/arm/kzm.c
 +    static gen_helper_gvec_3_ptr * const fns[3] = {
 +        gen_helper_gvec_fmul_idx_h,
 +        gen_helper_gvec_fmul_idx_s,
 +        gen_helper_gvec_fmul_idx_d,
 +    };
 +
 +    if (sve_access_check(s)) {
 +        unsigned vsz = vec_full_reg_size(s);
 +        TCGv_ptr status = get_fpstatus_ptr(a->esz == MO_16);
 +        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, a->rd),
 +                           vec_full_reg_offset(s, a->rn),
 +                           vec_full_reg_offset(s, a->rm),
 +                           status, vsz, vsz, a->index, fns[a->esz - 1]);
 +        tcg_temp_free_ptr(status);
 +    }
 +    return true;
 +}
 +
  /*
   *** SVE Floating Point Accumulating Reduction Group
   */
 diff --git a/target/arm/vec_helper.c b/target/arm/vec_helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/vec_helper.c
+--- a/hw/arm/kzm.c
-+++ b/target/arm/vec_helper.c
++++ b/hw/arm/kzm.c
-@@ -XXX,XX +XXX,XX @@ DO_3OP(gvec_rsqrts_d, helper_rsqrtsf_f64, float64)
+@@ -XXX,XX +XXX,XX @@
+ #include "qemu/error-report.h"
- #endif
+ #include "exec/address-spaces.h"
- #undef DO_3OP
+ #include "net/net.h"
-+
+-#include "hw/devices.h"
-+/* For the indexed ops, SVE applies the index per 128-bit vector segment.
++#include "hw/net/lan9118.h"
-+ * For AdvSIMD, there is of course only one such vector segment.
+ #include "hw/char/serial.h"
-+ */
+ #include "sysemu/qtest.h"
-+
-+#define DO_MUL_IDX(NAME, TYPE, H) \
+diff --git a/hw/arm/mps2.c b/hw/arm/mps2.c
 +void HELPER(NAME)(void *vd, void *vn, void *vm, void *stat, uint32_t desc) \
 +{                                                                          \
 +    intptr_t i, j, oprsz = simd_oprsz(desc), segment = 16 / sizeof(TYPE);  \
 +    intptr_t idx = simd_data(desc);                                        \
 +    TYPE *d = vd, *n = vn, *m = vm;                                        \
 +    for (i = 0; i < oprsz / sizeof(TYPE); i += segment) {                  \
 +        TYPE mm = m[H(i + idx)];                                           \
 +        for (j = 0; j < segment; j++) {                                    \
 +            d[i + j] = TYPE##_mul(n[i + j], mm, stat);                     \
 +        }                                                                  \
 +    }                                                                      \
 +}
 +
 +DO_MUL_IDX(gvec_fmul_idx_h, float16, H2)
 +DO_MUL_IDX(gvec_fmul_idx_s, float32, H4)
 +DO_MUL_IDX(gvec_fmul_idx_d, float64, )
 +
 +#undef DO_MUL_IDX
 +
 +#define DO_FMLA_IDX(NAME, TYPE, H)                                         \
 +void HELPER(NAME)(void *vd, void *vn, void *vm, void *va,                  \
 +                  void *stat, uint32_t desc)                               \
 +{                                                                          \
 +    intptr_t i, j, oprsz = simd_oprsz(desc), segment = 16 / sizeof(TYPE);  \
 +    TYPE op1_neg = extract32(desc, SIMD_DATA_SHIFT, 1);                    \
 +    intptr_t idx = desc >> (SIMD_DATA_SHIFT + 1);                          \
 +    TYPE *d = vd, *n = vn, *m = vm, *a = va;                               \
 +    op1_neg <<= (8 * sizeof(TYPE) - 1);                                    \
 +    for (i = 0; i < oprsz / sizeof(TYPE); i += segment) {                  \
 +        TYPE mm = m[H(i + idx)];                                           \
 +        for (j = 0; j < segment; j++) {                                    \
 +            d[i + j] = TYPE##_muladd(n[i + j] ^ op1_neg,                   \
 +                                     mm, a[i + j], 0, stat);               \
 +        }                                                                  \
 +    }                                                                      \
 +}
 +
 +DO_FMLA_IDX(gvec_fmla_idx_h, float16, H2)
 +DO_FMLA_IDX(gvec_fmla_idx_s, float32, H4)
 +DO_FMLA_IDX(gvec_fmla_idx_d, float64, )
 +
 +#undef DO_FMLA_IDX
 diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
+--- a/hw/arm/mps2.c
-+++ b/target/arm/sve.decode
++++ b/hw/arm/mps2.c
 @@ -XXX,XX +XXX,XX @@
- %imm9_16_10     16:s6 10:3
+ #include "hw/timer/cmsdk-apb-timer.h"
- %size_23        23:2
+ #include "hw/timer/cmsdk-apb-dualtimer.h"
- %dtype_23_13    23:2 13:2
+ #include "hw/misc/mps2-scc.h"
-+%index3_22_19   22:1 19:2
+-#include "hw/devices.h"
++#include "hw/net/lan9118.h"
- # A combination of tsz:imm3 -- extract esize.
+ #include "net/net.h"
- %tszimm_esz     22:2 5:5 !function=tszimm_esz
-@@ -XXX,XX +XXX,XX @@ UMIN_zzi        00100101 .. 101 011 110 ........ .....          @rdn_i8u
+ typedef enum MPS2FPGAType {
- # SVE integer multiply immediate (unpredicated)
+diff --git a/hw/arm/realview.c b/hw/arm/realview.c
- MUL_zzi         00100101 .. 110 000 110 ........ .....          @rdn_i8s
+index XXXXXXX..XXXXXXX 100644
+--- a/hw/arm/realview.c
-+### SVE FP Multiply-Add Indexed Group
++++ b/hw/arm/realview.c
-+
+@@ -XXX,XX +XXX,XX @@
-+# SVE floating-point multiply-add (indexed)
+ #include "hw/arm/arm.h"
-+FMLA_zzxz       01100100 0.1 .. rm:3 00000 sub:1 rn:5 rd:5 \
+ #include "hw/arm/primecell.h"
-+                ra=%reg_movprfx index=%index3_22_19 esz=1
+ #include "hw/devices.h"
-+FMLA_zzxz       01100100 101 index:2 rm:3 00000 sub:1 rn:5 rd:5 \
++#include "hw/net/lan9118.h"
-+                ra=%reg_movprfx esz=2
+ #include "hw/pci/pci.h"
-+FMLA_zzxz       01100100 111 index:1 rm:4 00000 sub:1 rn:5 rd:5 \
+ #include "net/net.h"
-+                ra=%reg_movprfx esz=3
+ #include "sysemu/sysemu.h"
-+
+diff --git a/hw/arm/vexpress.c b/hw/arm/vexpress.c
-+### SVE FP Multiply Indexed Group
+index XXXXXXX..XXXXXXX 100644
-+
+--- a/hw/arm/vexpress.c
-+# SVE floating-point multiply (indexed)
++++ b/hw/arm/vexpress.c
-+FMUL_zzx        01100100 0.1 .. rm:3 001000 rn:5 rd:5 \
+@@ -XXX,XX +XXX,XX @@
-+                index=%index3_22_19 esz=1
+ #include "hw/sysbus.h"
-+FMUL_zzx        01100100 101 index:2 rm:3 001000 rn:5 rd:5      esz=2
+ #include "hw/arm/arm.h"
-+FMUL_zzx        01100100 111 index:1 rm:4 001000 rn:5 rd:5      esz=3
+ #include "hw/arm/primecell.h"
-+
+-#include "hw/devices.h"
- ### SVE FP Accumulating Reduction Group
++#include "hw/net/lan9118.h"
+ #include "hw/i2c/i2c.h"
- # SVE floating-point serial reduction (predicated)
+ #include "net/net.h"
  #include "sysemu/sysemu.h"
 diff --git a/hw/net/lan9118.c b/hw/net/lan9118.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/net/lan9118.c
 +++ b/hw/net/lan9118.c
@@ -XXX,XX +XXX,XX @@
  #include "hw/sysbus.h"
  #include "net/net.h"
  #include "net/eth.h"
 -#include "hw/devices.h"
 +#include "hw/net/lan9118.h"
  #include "sysemu/sysemu.h"
  #include "hw/ptimer.h"
  #include "qemu/log.h"
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 18/55] target/arm: Implement SVE prefetches
+[Qemu-devel] [PULL 40/42] hw/net/ne2000-isa: Add guards to the header
-From: Richard Henderson <richard.henderson@linaro.org>
+From: Philippe Mathieu-Daudé <philmd@redhat.com>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Thomas Huth <thuth@redhat.com>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Reviewed-by: Markus Armbruster <armbru@redhat.com>
-Message-id: 20180627043328.11531-13-richard.henderson@linaro.org
+Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Message-id: 20190412165416.7977-11-philmd@redhat.com
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/translate-sve.c | 21 +++++++++++++++++++++
+ include/hw/net/ne2000-isa.h | 6 ++++++
- target/arm/sve.decode      | 23 +++++++++++++++++++++++
+file changed, 6 insertions(+)
 files changed, 44 insertions(+)
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
+diff --git a/include/hw/net/ne2000-isa.h b/include/hw/net/ne2000-isa.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
+--- a/include/hw/net/ne2000-isa.h
-+++ b/target/arm/translate-sve.c
++++ b/include/hw/net/ne2000-isa.h
-@@ -XXX,XX +XXX,XX @@ static bool trans_ST1_zprz(DisasContext *s, arg_ST1_zprz *a, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@
-                cpu_reg_sp(s, a->rn), fn);
+  * This work is licensed under the terms of the GNU GPL, version 2 or later.
-     return true;
+  * See the COPYING file in the top-level directory.
   */
 +
 +#ifndef HW_NET_NE2K_ISA_H
 +#define HW_NET_NE2K_ISA_H
 +
  #include "hw/hw.h"
  #include "hw/qdev.h"
  #include "hw/isa/isa.h"
@@ -XXX,XX +XXX,XX @@ static inline ISADevice *isa_ne2000_init(ISABus *bus, int base, int irq,
      }
      return d;
  }
 +
-+/*
++#endif
 + * Prefetches
 + */
 +
 +static bool trans_PRF(DisasContext *s, arg_PRF *a, uint32_t insn)
 +{
 +    /* Prefetch is a nop within QEMU.  */
 +    sve_access_check(s);
 +    return true;
 +}
 +
 +static bool trans_PRF_rr(DisasContext *s, arg_PRF_rr *a, uint32_t insn)
 +{
 +    if (a->rm == 31) {
 +        return false;
 +    }
 +    /* Prefetch is a nop within QEMU.  */
 +    sve_access_check(s);
 +    return true;
 +}
 diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve.decode
 +++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@ LD1RQ_zprr      1010010 .. 00 ..... 000 ... ..... ..... \
  LD1RQ_zpri      1010010 .. 00 0.... 001 ... ..... ..... \
                  @rpri_load_msz nreg=0
 +# SVE 32-bit gather prefetch (scalar plus 32-bit scaled offsets)
 +PRF             1000010 00 -1 ----- 0-- --- ----- 0 ----
 +
 +# SVE 32-bit gather prefetch (vector plus immediate)
 +PRF             1000010 -- 00 ----- 111 --- ----- 0 ----
 +
 +# SVE contiguous prefetch (scalar plus immediate)
 +PRF             1000010 11 1- ----- 0-- --- ----- 0 ----
 +
 +# SVE contiguous prefetch (scalar plus scalar)
 +PRF_rr          1000010 -- 00 rm:5 110 --- ----- 0 ----
 +
 +### SVE Memory 64-bit Gather Group
 +
 +# SVE 64-bit gather prefetch (scalar plus 64-bit scaled offsets)
 +PRF             1100010 00 11 ----- 1-- --- ----- 0 ----
 +
 +# SVE 64-bit gather prefetch (scalar plus unpacked 32-bit scaled offsets)
 +PRF             1100010 00 -1 ----- 0-- --- ----- 0 ----
 +
 +# SVE 64-bit gather prefetch (vector plus immediate)
 +PRF             1100010 -- 00 ----- 111 --- ----- 0 ----
 +
  ### SVE Memory Store Group
  # SVE store predicate register
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 20/55] target/arm: Implement SVE first-fault gather loads
+[Qemu-devel] [PULL 41/42] hw/net/lan9118: Export TYPE_LAN9118 and use it instead of hardcoded string
-From: Richard Henderson <richard.henderson@linaro.org>
+From: Philippe Mathieu-Daudé <philmd@redhat.com>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
+Reviewed-by: Markus Armbruster <armbru@redhat.com>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
-Message-id: 20180627043328.11531-15-richard.henderson@linaro.org
+Message-id: 20190412165416.7977-12-philmd@redhat.com
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper-sve.h    | 67 +++++++++++++++++++++++++++++
+ include/hw/net/lan9118.h | 2 ++
- target/arm/sve_helper.c    | 88 ++++++++++++++++++++++++++++++++++++++
+ hw/arm/exynos4_boards.c  | 3 ++-
- target/arm/translate-sve.c | 40 ++++++++++++++++-
+ hw/arm/mps2-tz.c         | 3 ++-
-files changed, 193 insertions(+), 2 deletions(-)
+ hw/net/lan9118.c         | 1 -
 files changed, 6 insertions(+), 3 deletions(-)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
+diff --git a/include/hw/net/lan9118.h b/include/hw/net/lan9118.h
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
+--- a/include/hw/net/lan9118.h
-+++ b/target/arm/helper-sve.h
++++ b/include/hw/net/lan9118.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_6(sve_ldhds_zd, TCG_CALL_NO_WG,
+@@ -XXX,XX +XXX,XX @@
- DEF_HELPER_FLAGS_6(sve_ldsds_zd, TCG_CALL_NO_WG,
+ #include "hw/irq.h"
-                    void, env, ptr, ptr, ptr, tl, i32)
+ #include "net/net.h"
-+DEF_HELPER_FLAGS_6(sve_ldffbsu_zsu, TCG_CALL_NO_WG,
++#define TYPE_LAN9118 "lan9118"
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhsu_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffssu_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffbss_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhss_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
-+DEF_HELPER_FLAGS_6(sve_ldffbsu_zss, TCG_CALL_NO_WG,
+ void lan9118_init(NICInfo *, uint32_t, qemu_irq);
-+                   void, env, ptr, ptr, ptr, tl, i32)
-+DEF_HELPER_FLAGS_6(sve_ldffhsu_zss, TCG_CALL_NO_WG,
+ #endif
-+                   void, env, ptr, ptr, ptr, tl, i32)
+diff --git a/hw/arm/exynos4_boards.c b/hw/arm/exynos4_boards.c
 +DEF_HELPER_FLAGS_6(sve_ldffssu_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffbss_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhss_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_ldffbdu_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhdu_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsdu_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffddu_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffbds_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhds_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsds_zsu, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_ldffbdu_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhdu_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsdu_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffddu_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffbds_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhds_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsds_zss, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_6(sve_ldffbdu_zd, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhdu_zd, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsdu_zd, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffddu_zd, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffbds_zd, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffhds_zd, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +DEF_HELPER_FLAGS_6(sve_ldffsds_zd, TCG_CALL_NO_WG,
 +                   void, env, ptr, ptr, ptr, tl, i32)
 +
  DEF_HELPER_FLAGS_6(sve_stbs_zsu, TCG_CALL_NO_WG,
                     void, env, ptr, ptr, ptr, tl, i32)
  DEF_HELPER_FLAGS_6(sve_sths_zsu, TCG_CALL_NO_WG,
 diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve_helper.c
+--- a/hw/arm/exynos4_boards.c
-+++ b/target/arm/sve_helper.c
++++ b/hw/arm/exynos4_boards.c
-@@ -XXX,XX +XXX,XX @@ DO_LD1_ZPZ_D(sve_ldbds_zd, uint64_t, int8_t,   cpu_ldub_data_ra)
+@@ -XXX,XX +XXX,XX @@
- DO_LD1_ZPZ_D(sve_ldhds_zd, uint64_t, int16_t,  cpu_lduw_data_ra)
+ #include "hw/arm/arm.h"
- DO_LD1_ZPZ_D(sve_ldsds_zd, uint64_t, int32_t,  cpu_ldl_data_ra)
+ #include "exec/address-spaces.h"
+ #include "hw/arm/exynos4210.h"
-+/* First fault loads with a vector index.  */
++#include "hw/net/lan9118.h"
-+
+ #include "hw/boards.h"
-+#ifdef CONFIG_USER_ONLY
-+
+ #undef DEBUG
-+#define DO_LDFF1_ZPZ(NAME, TYPEE, TYPEI, TYPEM, FN, H)                  \
+@@ -XXX,XX +XXX,XX @@ static void lan9215_init(uint32_t base, qemu_irq irq)
-+void HELPER(NAME)(CPUARMState *env, void *vd, void *vg, void *vm,       \
+     /* This should be a 9215 but the 9118 is close enough */
-+                  target_ulong base, uint32_t desc)                     \
+     if (nd_table[0].used) {
-+{                                                                       \
+         qemu_check_nic_model(&nd_table[0], "lan9118");
-+    intptr_t i, oprsz = simd_oprsz(desc);                               \
+-        dev = qdev_create(NULL, "lan9118");
-+    unsigned scale = simd_data(desc);                                   \
++        dev = qdev_create(NULL, TYPE_LAN9118);
-+    uintptr_t ra = GETPC();                                             \
+         qdev_set_nic_properties(dev, &nd_table[0]);
-+    bool first = true;                                                  \
+         qdev_prop_set_uint32(dev, "mode_16bit", 1);
-+    mmap_lock();                                                        \
+         qdev_init_nofail(dev);
-+    for (i = 0; i < oprsz; i++) {                                       \
+diff --git a/hw/arm/mps2-tz.c b/hw/arm/mps2-tz.c
 +        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));                 \
 +        do {                                                            \
 +            TYPEM m = 0;                                                \
 +            if (pg & 1) {                                               \
 +                target_ulong off = *(TYPEI *)(vm + H(i));               \
 +                target_ulong addr = base + (off << scale);              \
 +                if (!first &&                                           \
 +                    page_check_range(addr, sizeof(TYPEM), PAGE_READ)) { \
 +                    record_fault(env, i, oprsz);                        \
 +                    goto exit;                                          \
 +                }                                                       \
 +                m = FN(env, addr, ra);                                  \
 +                first = false;                                          \
 +            }                                                           \
 +            *(TYPEE *)(vd + H(i)) = m;                                  \
 +            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);                   \
 +        } while (i & 15);                                               \
 +    }                                                                   \
 + exit:                                                                  \
 +    mmap_unlock();                                                      \
 +}
 +
 +#else
 +
 +#define DO_LDFF1_ZPZ(NAME, TYPEE, TYPEI, TYPEM, FN, H)                  \
 +void HELPER(NAME)(CPUARMState *env, void *vd, void *vg, void *vm,       \
 +                  target_ulong base, uint32_t desc)                     \
 +{                                                                       \
 +    g_assert_not_reached();                                             \
 +}
 +
 +#endif
 +
 +#define DO_LDFF1_ZPZ_S(NAME, TYPEI, TYPEM, FN) \
 +    DO_LDFF1_ZPZ(NAME, uint32_t, TYPEI, TYPEM, FN, H1_4)
 +#define DO_LDFF1_ZPZ_D(NAME, TYPEI, TYPEM, FN) \
 +    DO_LDFF1_ZPZ(NAME, uint64_t, TYPEI, TYPEM, FN, )
 +
 +DO_LDFF1_ZPZ_S(sve_ldffbsu_zsu, uint32_t, uint8_t,  cpu_ldub_data_ra)
 +DO_LDFF1_ZPZ_S(sve_ldffhsu_zsu, uint32_t, uint16_t, cpu_lduw_data_ra)
 +DO_LDFF1_ZPZ_S(sve_ldffssu_zsu, uint32_t, uint32_t, cpu_ldl_data_ra)
 +DO_LDFF1_ZPZ_S(sve_ldffbss_zsu, uint32_t, int8_t,   cpu_ldub_data_ra)
 +DO_LDFF1_ZPZ_S(sve_ldffhss_zsu, uint32_t, int16_t,  cpu_lduw_data_ra)
 +
 +DO_LDFF1_ZPZ_S(sve_ldffbsu_zss, int32_t, uint8_t,  cpu_ldub_data_ra)
 +DO_LDFF1_ZPZ_S(sve_ldffhsu_zss, int32_t, uint16_t, cpu_lduw_data_ra)
 +DO_LDFF1_ZPZ_S(sve_ldffssu_zss, int32_t, uint32_t, cpu_ldl_data_ra)
 +DO_LDFF1_ZPZ_S(sve_ldffbss_zss, int32_t, int8_t,   cpu_ldub_data_ra)
 +DO_LDFF1_ZPZ_S(sve_ldffhss_zss, int32_t, int16_t,  cpu_lduw_data_ra)
 +
 +DO_LDFF1_ZPZ_D(sve_ldffbdu_zsu, uint32_t, uint8_t,  cpu_ldub_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffhdu_zsu, uint32_t, uint16_t, cpu_lduw_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffsdu_zsu, uint32_t, uint32_t, cpu_ldl_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffddu_zsu, uint32_t, uint64_t, cpu_ldq_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffbds_zsu, uint32_t, int8_t,   cpu_ldub_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffhds_zsu, uint32_t, int16_t,  cpu_lduw_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffsds_zsu, uint32_t, int32_t,  cpu_ldl_data_ra)
 +
 +DO_LDFF1_ZPZ_D(sve_ldffbdu_zss, int32_t, uint8_t,  cpu_ldub_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffhdu_zss, int32_t, uint16_t, cpu_lduw_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffsdu_zss, int32_t, uint32_t, cpu_ldl_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffddu_zss, int32_t, uint64_t, cpu_ldq_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffbds_zss, int32_t, int8_t,   cpu_ldub_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffhds_zss, int32_t, int16_t,  cpu_lduw_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffsds_zss, int32_t, int32_t,  cpu_ldl_data_ra)
 +
 +DO_LDFF1_ZPZ_D(sve_ldffbdu_zd, uint64_t, uint8_t,  cpu_ldub_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffhdu_zd, uint64_t, uint16_t, cpu_lduw_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffsdu_zd, uint64_t, uint32_t, cpu_ldl_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffddu_zd, uint64_t, uint64_t, cpu_ldq_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffbds_zd, uint64_t, int8_t,   cpu_ldub_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffhds_zd, uint64_t, int16_t,  cpu_lduw_data_ra)
 +DO_LDFF1_ZPZ_D(sve_ldffsds_zd, uint64_t, int32_t,  cpu_ldl_data_ra)
 +
  /* Stores with a vector index.  */
  #define DO_ST1_ZPZ_S(NAME, TYPEI, FN)                                   \
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
+--- a/hw/arm/mps2-tz.c
-+++ b/target/arm/translate-sve.c
++++ b/hw/arm/mps2-tz.c
-@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_mem_scatter * const gather_load_fn32[2][2][2][3] = {
+@@ -XXX,XX +XXX,XX @@
-         { gen_helper_sve_ldbsu_zss,
+ #include "hw/arm/armsse.h"
-           gen_helper_sve_ldhsu_zss,
+ #include "hw/dma/pl080.h"
-           gen_helper_sve_ldssu_zss, } } },
+ #include "hw/ssi/pl022.h"
--    /* TODO fill in first-fault handlers */
++#include "hw/net/lan9118.h"
-+
+ #include "net/net.h"
-+    { { { gen_helper_sve_ldffbss_zsu,
+ #include "hw/core/split-irq.h"
-+          gen_helper_sve_ldffhss_zsu,
-+          NULL, },
+@@ -XXX,XX +XXX,XX @@ static MemoryRegion *make_eth_dev(MPS2TZMachineState *mms, void *opaque,
-+        { gen_helper_sve_ldffbsu_zsu,
+      * except that it doesn't support the checksum-offload feature.
-+          gen_helper_sve_ldffhsu_zsu,
+      */
-+          gen_helper_sve_ldffssu_zsu, } },
+     qemu_check_nic_model(nd, "lan9118");
-+      { { gen_helper_sve_ldffbss_zss,
+-    mms->lan9118 = qdev_create(NULL, "lan9118");
-+          gen_helper_sve_ldffhss_zss,
++    mms->lan9118 = qdev_create(NULL, TYPE_LAN9118);
-+          NULL, },
+     qdev_set_nic_properties(mms->lan9118, nd);
-+        { gen_helper_sve_ldffbsu_zss,
+     qdev_init_nofail(mms->lan9118);
-+          gen_helper_sve_ldffhsu_zss,
-+          gen_helper_sve_ldffssu_zss, } } }
+diff --git a/hw/net/lan9118.c b/hw/net/lan9118.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/net/lan9118.c
 +++ b/hw/net/lan9118.c
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_lan9118_packet = {
      }
  };
- /* Note that we overload xs=2 to indicate 64-bit offset.  */
+-#define TYPE_LAN9118 "lan9118"
-@@ -XXX,XX +XXX,XX @@ static gen_helper_gvec_mem_scatter * const gather_load_fn64[2][3][2][4] = {
+ #define LAN9118(obj) OBJECT_CHECK(lan9118_state, (obj), TYPE_LAN9118)
-           gen_helper_sve_ldhdu_zd,
-           gen_helper_sve_ldsdu_zd,
+ typedef struct {
            gen_helper_sve_ldddu_zd, } } },
 -    /* TODO fill in first-fault handlers */
 +
 +    { { { gen_helper_sve_ldffbds_zsu,
 +          gen_helper_sve_ldffhds_zsu,
 +          gen_helper_sve_ldffsds_zsu,
 +          NULL, },
 +        { gen_helper_sve_ldffbdu_zsu,
 +          gen_helper_sve_ldffhdu_zsu,
 +          gen_helper_sve_ldffsdu_zsu,
 +          gen_helper_sve_ldffddu_zsu, } },
 +      { { gen_helper_sve_ldffbds_zss,
 +          gen_helper_sve_ldffhds_zss,
 +          gen_helper_sve_ldffsds_zss,
 +          NULL, },
 +        { gen_helper_sve_ldffbdu_zss,
 +          gen_helper_sve_ldffhdu_zss,
 +          gen_helper_sve_ldffsdu_zss,
 +          gen_helper_sve_ldffddu_zss, } },
 +      { { gen_helper_sve_ldffbds_zd,
 +          gen_helper_sve_ldffhds_zd,
 +          gen_helper_sve_ldffsds_zd,
 +          NULL, },
 +        { gen_helper_sve_ldffbdu_zd,
 +          gen_helper_sve_ldffhdu_zd,
 +          gen_helper_sve_ldffsdu_zd,
 +          gen_helper_sve_ldffddu_zd, } } }
  };
  static bool trans_LD1_zprz(DisasContext *s, arg_LD1_zprz *a, uint32_t insn)
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 08/55] target/arm: Implement SVE Contiguous Load, first-fault and no-fault
+[Qemu-devel] [PULL 42/42] hw/devices: Move SMSC 91C111 declaration into a new header
-From: Richard Henderson <richard.henderson@linaro.org>
+From: Philippe Mathieu-Daudé <philmd@redhat.com>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
+This commit finally deletes "hw/devices.h".
-Reviewed-by: Alex Bennée <alex.bennee@linaro.org>
-Tested-by: Alex Bennée <alex.bennee@linaro.org>
+Reviewed-by: Markus Armbruster <armbru@redhat.com>
-Message-id: 20180627043328.11531-3-richard.henderson@linaro.org
+Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
 Message-id: 20190412165416.7977-13-philmd@redhat.com
 Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
 ---
- target/arm/helper-sve.h    |  40 ++++++++++
+ include/hw/devices.h       | 11 -----------
- target/arm/sve_helper.c    | 157 +++++++++++++++++++++++++++++++++++++
+ include/hw/net/smc91c111.h | 19 +++++++++++++++++++
- target/arm/translate-sve.c |  69 ++++++++++++++++
+ hw/arm/gumstix.c           |  2 +-
- target/arm/sve.decode      |   6 ++
+ hw/arm/integratorcp.c      |  2 +-
-files changed, 272 insertions(+)
+ hw/arm/mainstone.c         |  2 +-
  hw/arm/realview.c          |  2 +-
  hw/arm/versatilepb.c       |  2 +-
  hw/net/smc91c111.c         |  2 +-
 files changed, 25 insertions(+), 17 deletions(-)
  delete mode 100644 include/hw/devices.h
  create mode 100644 include/hw/net/smc91c111.h
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
+diff --git a/include/hw/devices.h b/include/hw/devices.h
-index XXXXXXX..XXXXXXX 100644
+deleted file mode 100644
---- a/target/arm/helper-sve.h
+index XXXXXXX..XXXXXXX
-+++ b/target/arm/helper-sve.h
+--- a/include/hw/devices.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_4(sve_ld1hds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
++++ /dev/null
+@@ -XXX,XX +XXX,XX @@
- DEF_HELPER_FLAGS_4(sve_ld1sdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+-#ifndef QEMU_DEVICES_H
- DEF_HELPER_FLAGS_4(sve_ld1sds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+-#define QEMU_DEVICES_H
-+
+-
-+DEF_HELPER_FLAGS_4(sve_ldff1bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+-/* Devices that have nowhere better to go.  */
-+DEF_HELPER_FLAGS_4(sve_ldff1bhu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+-
-+DEF_HELPER_FLAGS_4(sve_ldff1bsu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+-#include "hw/hw.h"
-+DEF_HELPER_FLAGS_4(sve_ldff1bdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+-
-+DEF_HELPER_FLAGS_4(sve_ldff1bhs_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+-/* smc91c111.c */
-+DEF_HELPER_FLAGS_4(sve_ldff1bss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+-void smc91c111_init(NICInfo *, uint32_t, qemu_irq);
-+DEF_HELPER_FLAGS_4(sve_ldff1bds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+-
-+
+-#endif
-+DEF_HELPER_FLAGS_4(sve_ldff1hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+diff --git a/include/hw/net/smc91c111.h b/include/hw/net/smc91c111.h
-+DEF_HELPER_FLAGS_4(sve_ldff1hsu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+new file mode 100644
-+DEF_HELPER_FLAGS_4(sve_ldff1hdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+index XXXXXXX..XXXXXXX
-+DEF_HELPER_FLAGS_4(sve_ldff1hss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+--- /dev/null
-+DEF_HELPER_FLAGS_4(sve_ldff1hds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
++++ b/include/hw/net/smc91c111.h
-+
+@@ -XXX,XX +XXX,XX @@
 +DEF_HELPER_FLAGS_4(sve_ldff1ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldff1sdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldff1sds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ldff1dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ldnf1bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1bhu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1bsu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1bdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1bhs_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1bss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1bds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ldnf1hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1hsu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1hdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1hss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1hds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ldnf1ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1sdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +DEF_HELPER_FLAGS_4(sve_ldnf1sds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 +
 +DEF_HELPER_FLAGS_4(sve_ldnf1dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
 index XXXXXXX..XXXXXXX 100644
 --- a/target/arm/sve_helper.c
 +++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ DO_LD4(sve_ld4dd_r, cpu_ldq_data_ra, uint64_t, uint64_t, )
  #undef DO_LD2
  #undef DO_LD3
  #undef DO_LD4
 +
 +/*
-+ * Load contiguous data, first-fault and no-fault.
++ * SMSC 91C111 Ethernet interface emulation
 + *
 + * Copyright (c) 2005 CodeSourcery, LLC.
 + * Written by Paul Brook
 + *
 + * This work is licensed under the terms of the GNU GPL, version 2 or later.
 + * See the COPYING file in the top-level directory.
 + */
 +
-+#ifdef CONFIG_USER_ONLY
++#ifndef HW_NET_SMC91C111_H
 +#define HW_NET_SMC91C111_H
 +
-+/* Fault on byte I.  All bits in FFR from I are cleared.  The vector
++#include "hw/irq.h"
-+ * result from I is CONSTRAINED UNPREDICTABLE; we choose the MERGE
++#include "net/net.h"
 + * option, which leaves subsequent data unchanged.
 + */
 +static void record_fault(CPUARMState *env, uintptr_t i, uintptr_t oprsz)
 +{
 +    uint64_t *ffr = env->vfp.pregs[FFR_PRED_NUM].p;
 +
-+    if (i & 63) {
++void smc91c111_init(NICInfo *, uint32_t, qemu_irq);
 +        ffr[i / 64] &= MAKE_64BIT_MASK(0, i & 63);
 +        i = ROUND_UP(i, 64);
 +    }
 +    for (; i < oprsz; i += 64) {
 +        ffr[i / 64] = 0;
 +    }
 +}
 +
 +/* Hold the mmap lock during the operation so that there is no race
 + * between page_check_range and the load operation.  We expect the
 + * usual case to have no faults at all, so we check the whole range
 + * first and if successful defer to the normal load operation.
 + *
 + * TODO: Change mmap_lock to a rwlock so that multiple readers
 + * can run simultaneously.  This will probably help other uses
 + * within QEMU as well.
 + */
 +#define DO_LDFF1(PART, FN, TYPEE, TYPEM, H)                             \
 +static void do_sve_ldff1##PART(CPUARMState *env, void *vd, void *vg,    \
 +                               target_ulong addr, intptr_t oprsz,       \
 +                               bool first, uintptr_t ra)                \
 +{                                                                       \
 +    intptr_t i = 0;                                                     \
 +    do {                                                                \
 +        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));                 \
 +        do {                                                            \
 +            TYPEM m = 0;                                                \
 +            if (pg & 1) {                                               \
 +                if (!first &&                                           \
 +                    unlikely(page_check_range(addr, sizeof(TYPEM),      \
 +                                              PAGE_READ))) {            \
 +                    record_fault(env, i, oprsz);                        \
 +                    return;                                             \
 +                }                                                       \
 +                m = FN(env, addr, ra);                                  \
 +                first = false;                                          \
 +            }                                                           \
 +            *(TYPEE *)(vd + H(i)) = m;                                  \
 +            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);                   \
 +            addr += sizeof(TYPEM);                                      \
 +        } while (i & 15);                                               \
 +    } while (i < oprsz);                                                \
 +}                                                                       \
 +void HELPER(sve_ldff1##PART)(CPUARMState *env, void *vg,                \
 +                             target_ulong addr, uint32_t desc)          \
 +{                                                                       \
 +    intptr_t oprsz = simd_oprsz(desc);                                  \
 +    unsigned rd = simd_data(desc);                                      \
 +    void *vd = &env->vfp.zregs[rd];                                     \
 +    mmap_lock();                                                        \
 +    if (likely(page_check_range(addr, oprsz, PAGE_READ) == 0)) {        \
 +        do_sve_ld1##PART(env, vd, vg, addr, oprsz, GETPC());            \
 +    } else {                                                            \
 +        do_sve_ldff1##PART(env, vd, vg, addr, oprsz, true, GETPC());    \
 +    }                                                                   \
 +    mmap_unlock();                                                      \
 +}
 +
 +/* No-fault loads are like first-fault loads without the
 + * first faulting special case.
 + */
 +#define DO_LDNF1(PART)                                                  \
 +void HELPER(sve_ldnf1##PART)(CPUARMState *env, void *vg,                \
 +                             target_ulong addr, uint32_t desc)          \
 +{                                                                       \
 +    intptr_t oprsz = simd_oprsz(desc);                                  \
 +    unsigned rd = simd_data(desc);                                      \
 +    void *vd = &env->vfp.zregs[rd];                                     \
 +    mmap_lock();                                                        \
 +    if (likely(page_check_range(addr, oprsz, PAGE_READ) == 0)) {        \
 +        do_sve_ld1##PART(env, vd, vg, addr, oprsz, GETPC());            \
 +    } else {                                                            \
 +        do_sve_ldff1##PART(env, vd, vg, addr, oprsz, false, GETPC());   \
 +    }                                                                   \
 +    mmap_unlock();                                                      \
 +}
 +
 +#else
 +
 +/* TODO: System mode is not yet supported.
 + * This would probably use tlb_vaddr_to_host.
 + */
 +#define DO_LDFF1(PART, FN, TYPEE, TYPEM, H)                     \
 +void HELPER(sve_ldff1##PART)(CPUARMState *env, void *vg,        \
 +                  target_ulong addr, uint32_t desc)             \
 +{                                                               \
 +    g_assert_not_reached();                                     \
 +}
 +
 +#define DO_LDNF1(PART)                                          \
 +void HELPER(sve_ldnf1##PART)(CPUARMState *env, void *vg,        \
 +                  target_ulong addr, uint32_t desc)             \
 +{                                                               \
 +    g_assert_not_reached();                                     \
 +}
 +
 +#endif
-+
+diff --git a/hw/arm/gumstix.c b/hw/arm/gumstix.c
 +DO_LDFF1(bb_r,  cpu_ldub_data_ra, uint8_t, uint8_t, H1)
 +DO_LDFF1(bhu_r, cpu_ldub_data_ra, uint16_t, uint8_t, H1_2)
 +DO_LDFF1(bhs_r, cpu_ldsb_data_ra, uint16_t, int8_t, H1_2)
 +DO_LDFF1(bsu_r, cpu_ldub_data_ra, uint32_t, uint8_t, H1_4)
 +DO_LDFF1(bss_r, cpu_ldsb_data_ra, uint32_t, int8_t, H1_4)
 +DO_LDFF1(bdu_r, cpu_ldub_data_ra, uint64_t, uint8_t, )
 +DO_LDFF1(bds_r, cpu_ldsb_data_ra, uint64_t, int8_t, )
 +
 +DO_LDFF1(hh_r,  cpu_lduw_data_ra, uint16_t, uint16_t, H1_2)
 +DO_LDFF1(hsu_r, cpu_lduw_data_ra, uint32_t, uint16_t, H1_4)
 +DO_LDFF1(hss_r, cpu_ldsw_data_ra, uint32_t, int8_t, H1_4)
 +DO_LDFF1(hdu_r, cpu_lduw_data_ra, uint64_t, uint16_t, )
 +DO_LDFF1(hds_r, cpu_ldsw_data_ra, uint64_t, int16_t, )
 +
 +DO_LDFF1(ss_r,  cpu_ldl_data_ra, uint32_t, uint32_t, H1_4)
 +DO_LDFF1(sdu_r, cpu_ldl_data_ra, uint64_t, uint32_t, )
 +DO_LDFF1(sds_r, cpu_ldl_data_ra, uint64_t, int32_t, )
 +
 +DO_LDFF1(dd_r,  cpu_ldq_data_ra, uint64_t, uint64_t, )
 +
 +#undef DO_LDFF1
 +
 +DO_LDNF1(bb_r)
 +DO_LDNF1(bhu_r)
 +DO_LDNF1(bhs_r)
 +DO_LDNF1(bsu_r)
 +DO_LDNF1(bss_r)
 +DO_LDNF1(bdu_r)
 +DO_LDNF1(bds_r)
 +
 +DO_LDNF1(hh_r)
 +DO_LDNF1(hsu_r)
 +DO_LDNF1(hss_r)
 +DO_LDNF1(hdu_r)
 +DO_LDNF1(hds_r)
 +
 +DO_LDNF1(ss_r)
 +DO_LDNF1(sdu_r)
 +DO_LDNF1(sds_r)
 +
 +DO_LDNF1(dd_r)
 +
 +#undef DO_LDNF1
 diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
+--- a/hw/arm/gumstix.c
-+++ b/target/arm/translate-sve.c
++++ b/hw/arm/gumstix.c
-@@ -XXX,XX +XXX,XX @@ static bool trans_LD_zpri(DisasContext *s, arg_rpri_load *a, uint32_t insn)
+@@ -XXX,XX +XXX,XX @@
-     }
+ #include "hw/arm/pxa.h"
-     return true;
+ #include "net/net.h"
- }
+ #include "hw/block/flash.h"
-+
+-#include "hw/devices.h"
-+static bool trans_LDFF1_zprr(DisasContext *s, arg_rprr_load *a, uint32_t insn)
++#include "hw/net/smc91c111.h"
-+{
+ #include "hw/boards.h"
-+    static gen_helper_gvec_mem * const fns[16] = {
+ #include "exec/address-spaces.h"
-+        gen_helper_sve_ldff1bb_r,
+ #include "sysemu/qtest.h"
-+        gen_helper_sve_ldff1bhu_r,
+diff --git a/hw/arm/integratorcp.c b/hw/arm/integratorcp.c
 +        gen_helper_sve_ldff1bsu_r,
 +        gen_helper_sve_ldff1bdu_r,
 +
 +        gen_helper_sve_ldff1sds_r,
 +        gen_helper_sve_ldff1hh_r,
 +        gen_helper_sve_ldff1hsu_r,
 +        gen_helper_sve_ldff1hdu_r,
 +
 +        gen_helper_sve_ldff1hds_r,
 +        gen_helper_sve_ldff1hss_r,
 +        gen_helper_sve_ldff1ss_r,
 +        gen_helper_sve_ldff1sdu_r,
 +
 +        gen_helper_sve_ldff1bds_r,
 +        gen_helper_sve_ldff1bss_r,
 +        gen_helper_sve_ldff1bhs_r,
 +        gen_helper_sve_ldff1dd_r,
 +    };
 +
 +    if (sve_access_check(s)) {
 +        TCGv_i64 addr = new_tmp_a64(s);
 +        tcg_gen_shli_i64(addr, cpu_reg(s, a->rm), dtype_msz(a->dtype));
 +        tcg_gen_add_i64(addr, addr, cpu_reg_sp(s, a->rn));
 +        do_mem_zpa(s, a->rd, a->pg, addr, fns[a->dtype]);
 +    }
 +    return true;
 +}
 +
 +static bool trans_LDNF1_zpri(DisasContext *s, arg_rpri_load *a, uint32_t insn)
 +{
 +    static gen_helper_gvec_mem * const fns[16] = {
 +        gen_helper_sve_ldnf1bb_r,
 +        gen_helper_sve_ldnf1bhu_r,
 +        gen_helper_sve_ldnf1bsu_r,
 +        gen_helper_sve_ldnf1bdu_r,
 +
 +        gen_helper_sve_ldnf1sds_r,
 +        gen_helper_sve_ldnf1hh_r,
 +        gen_helper_sve_ldnf1hsu_r,
 +        gen_helper_sve_ldnf1hdu_r,
 +
 +        gen_helper_sve_ldnf1hds_r,
 +        gen_helper_sve_ldnf1hss_r,
 +        gen_helper_sve_ldnf1ss_r,
 +        gen_helper_sve_ldnf1sdu_r,
 +
 +        gen_helper_sve_ldnf1bds_r,
 +        gen_helper_sve_ldnf1bss_r,
 +        gen_helper_sve_ldnf1bhs_r,
 +        gen_helper_sve_ldnf1dd_r,
 +    };
 +
 +    if (sve_access_check(s)) {
 +        int vsz = vec_full_reg_size(s);
 +        int elements = vsz >> dtype_esz[a->dtype];
 +        int off = (a->imm * elements) << dtype_msz(a->dtype);
 +        TCGv_i64 addr = new_tmp_a64(s);
 +
 +        tcg_gen_addi_i64(addr, cpu_reg_sp(s, a->rn), off);
 +        do_mem_zpa(s, a->rd, a->pg, addr, fns[a->dtype]);
 +    }
 +    return true;
 +}
 diff --git a/target/arm/sve.decode b/target/arm/sve.decode
 index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
+--- a/hw/arm/integratorcp.c
-+++ b/target/arm/sve.decode
++++ b/hw/arm/integratorcp.c
-@@ -XXX,XX +XXX,XX @@ LDR_zri         10000101 10 ...... 010 ... ..... .....          @rd_rn_i9
+@@ -XXX,XX +XXX,XX @@
- # SVE contiguous load (scalar plus scalar)
+ #include "qemu-common.h"
- LD_zprr         1010010 .... ..... 010 ... ..... .....    @rprr_load_dt nreg=0
+ #include "cpu.h"
+ #include "hw/sysbus.h"
-+# SVE contiguous first-fault load (scalar plus scalar)
+-#include "hw/devices.h"
-+LDFF1_zprr      1010010 .... ..... 011 ... ..... .....    @rprr_load_dt nreg=0
+ #include "hw/boards.h"
-+
+ #include "hw/arm/arm.h"
- # SVE contiguous load (scalar plus immediate)
+ #include "hw/misc/arm_integrator_debug.h"
- LD_zpri         1010010 .... 0.... 101 ... ..... .....    @rpri_load_dt nreg=0
++#include "hw/net/smc91c111.h"
+ #include "net/net.h"
-+# SVE contiguous non-fault load (scalar plus immediate)
+ #include "exec/address-spaces.h"
-+LDNF1_zpri      1010010 .... 1.... 101 ... ..... .....    @rpri_load_dt nreg=0
+ #include "sysemu/sysemu.h"
-+
+diff --git a/hw/arm/mainstone.c b/hw/arm/mainstone.c
- # SVE contiguous non-temporal load (scalar plus scalar)
+index XXXXXXX..XXXXXXX 100644
- # LDNT1B, LDNT1H, LDNT1W, LDNT1D
+--- a/hw/arm/mainstone.c
- # SVE load multiple structures (scalar plus scalar)
++++ b/hw/arm/mainstone.c
@@ -XXX,XX +XXX,XX @@
  #include "hw/arm/pxa.h"
  #include "hw/arm/arm.h"
  #include "net/net.h"
 -#include "hw/devices.h"
 +#include "hw/net/smc91c111.h"
  #include "hw/boards.h"
  #include "hw/block/flash.h"
  #include "hw/sysbus.h"
 diff --git a/hw/arm/realview.c b/hw/arm/realview.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/arm/realview.c
 +++ b/hw/arm/realview.c
@@ -XXX,XX +XXX,XX @@
  #include "hw/sysbus.h"
  #include "hw/arm/arm.h"
  #include "hw/arm/primecell.h"
 -#include "hw/devices.h"
  #include "hw/net/lan9118.h"
 +#include "hw/net/smc91c111.h"
  #include "hw/pci/pci.h"
  #include "net/net.h"
  #include "sysemu/sysemu.h"
 diff --git a/hw/arm/versatilepb.c b/hw/arm/versatilepb.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/arm/versatilepb.c
 +++ b/hw/arm/versatilepb.c
@@ -XXX,XX +XXX,XX @@
  #include "cpu.h"
  #include "hw/sysbus.h"
  #include "hw/arm/arm.h"
 -#include "hw/devices.h"
 +#include "hw/net/smc91c111.h"
  #include "net/net.h"
  #include "sysemu/sysemu.h"
  #include "hw/pci/pci.h"
 diff --git a/hw/net/smc91c111.c b/hw/net/smc91c111.c
 index XXXXXXX..XXXXXXX 100644
 --- a/hw/net/smc91c111.c
 +++ b/hw/net/smc91c111.c
@@ -XXX,XX +XXX,XX @@
  #include "qemu/osdep.h"
  #include "hw/sysbus.h"
  #include "net/net.h"
 -#include "hw/devices.h"
 +#include "hw/net/smc91c111.h"
  #include "qemu/log.h"
  /* For crc32 */
  #include <zlib.h>
 --
-.17.1
+.20.1

-[Qemu-devel] [PULL 09/55] target/arm: Implement SVE Memory Contiguous Store Group
+Deleted patch
-From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20180627043328.11531-4-richard.henderson@linaro.org
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
----
- target/arm/helper-sve.h    |  29 +++++
- target/arm/sve_helper.c    | 211 +++++++++++++++++++++++++++++++++++++
- target/arm/translate-sve.c |  65 ++++++++++++
- target/arm/sve.decode      |  38 +++++++
-files changed, 343 insertions(+)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
-+++ b/target/arm/helper-sve.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_4(sve_ldnf1sdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
- DEF_HELPER_FLAGS_4(sve_ldnf1sds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
- DEF_HELPER_FLAGS_4(sve_ldnf1dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+
-+DEF_HELPER_FLAGS_4(sve_st1bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_st2bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_st3bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_st4bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+
-+DEF_HELPER_FLAGS_4(sve_st1hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_st2hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_st3hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_st4hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+
-+DEF_HELPER_FLAGS_4(sve_st1ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_st2ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_st3ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_st4ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+
-+DEF_HELPER_FLAGS_4(sve_st1dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_st2dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_st3dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_st4dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+
-+DEF_HELPER_FLAGS_4(sve_st1bh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_st1bs_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_st1bd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+
-+DEF_HELPER_FLAGS_4(sve_st1hs_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+DEF_HELPER_FLAGS_4(sve_st1hd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-+
-+DEF_HELPER_FLAGS_4(sve_st1sd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve_helper.c
-+++ b/target/arm/sve_helper.c
-@@ -XXX,XX +XXX,XX @@ DO_LDNF1(sds_r)
- DO_LDNF1(dd_r)
- #undef DO_LDNF1
-+
-+/*
-+ * Store contiguous data, protected by a governing predicate.
-+ */
-+#define DO_ST1(NAME, FN, TYPEE, TYPEM, H)                  \
-+void HELPER(NAME)(CPUARMState *env, void *vg,              \
-+                  target_ulong addr, uint32_t desc)        \
-+{                                                          \
-+    intptr_t i, oprsz = simd_oprsz(desc);                  \
-+    intptr_t ra = GETPC();                                 \
-+    unsigned rd = simd_data(desc);                         \
-+    void *vd = &env->vfp.zregs[rd];                        \
-+    for (i = 0; i < oprsz; ) {                             \
-+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));    \
-+        do {                                               \
-+            if (pg & 1) {                                  \
-+                TYPEM m = *(TYPEE *)(vd + H(i));           \
-+                FN(env, addr, m, ra);                      \
-+            }                                              \
-+            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);      \
-+            addr += sizeof(TYPEM);                         \
-+        } while (i & 15);                                  \
-+    }                                                      \
-+}
-+
-+#define DO_ST1_D(NAME, FN, TYPEM)                          \
-+void HELPER(NAME)(CPUARMState *env, void *vg,              \
-+                  target_ulong addr, uint32_t desc)        \
-+{                                                          \
-+    intptr_t i, oprsz = simd_oprsz(desc) / 8;              \
-+    intptr_t ra = GETPC();                                 \
-+    unsigned rd = simd_data(desc);                         \
-+    uint64_t *d = &env->vfp.zregs[rd].d[0];                \
-+    uint8_t *pg = vg;                                      \
-+    for (i = 0; i < oprsz; i += 1) {                       \
-+        if (pg[H1(i)] & 1) {                               \
-+            FN(env, addr, d[i], ra);                       \
-+        }                                                  \
-+        addr += sizeof(TYPEM);                             \
-+    }                                                      \
-+}
-+
-+#define DO_ST2(NAME, FN, TYPEE, TYPEM, H)                  \
-+void HELPER(NAME)(CPUARMState *env, void *vg,              \
-+                  target_ulong addr, uint32_t desc)        \
-+{                                                          \
-+    intptr_t i, oprsz = simd_oprsz(desc);                  \
-+    intptr_t ra = GETPC();                                 \
-+    unsigned rd = simd_data(desc);                         \
-+    void *d1 = &env->vfp.zregs[rd];                        \
-+    void *d2 = &env->vfp.zregs[(rd + 1) & 31];             \
-+    for (i = 0; i < oprsz; ) {                             \
-+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));    \
-+        do {                                               \
-+            if (pg & 1) {                                  \
-+                TYPEM m1 = *(TYPEE *)(d1 + H(i));          \
-+                TYPEM m2 = *(TYPEE *)(d2 + H(i));          \
-+                FN(env, addr, m1, ra);                     \
-+                FN(env, addr + sizeof(TYPEM), m2, ra);     \
-+            }                                              \
-+            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);      \
-+            addr += 2 * sizeof(TYPEM);                     \
-+        } while (i & 15);                                  \
-+    }                                                      \
-+}
-+
-+#define DO_ST3(NAME, FN, TYPEE, TYPEM, H)                  \
-+void HELPER(NAME)(CPUARMState *env, void *vg,              \
-+                  target_ulong addr, uint32_t desc)        \
-+{                                                          \
-+    intptr_t i, oprsz = simd_oprsz(desc);                  \
-+    intptr_t ra = GETPC();                                 \
-+    unsigned rd = simd_data(desc);                         \
-+    void *d1 = &env->vfp.zregs[rd];                        \
-+    void *d2 = &env->vfp.zregs[(rd + 1) & 31];             \
-+    void *d3 = &env->vfp.zregs[(rd + 2) & 31];             \
-+    for (i = 0; i < oprsz; ) {                             \
-+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));    \
-+        do {                                               \
-+            if (pg & 1) {                                  \
-+                TYPEM m1 = *(TYPEE *)(d1 + H(i));          \
-+                TYPEM m2 = *(TYPEE *)(d2 + H(i));          \
-+                TYPEM m3 = *(TYPEE *)(d3 + H(i));          \
-+                FN(env, addr, m1, ra);                     \
-+                FN(env, addr + sizeof(TYPEM), m2, ra);     \
-+                FN(env, addr + 2 * sizeof(TYPEM), m3, ra); \
-+            }                                              \
-+            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);      \
-+            addr += 3 * sizeof(TYPEM);                     \
-+        } while (i & 15);                                  \
-+    }                                                      \
-+}
-+
-+#define DO_ST4(NAME, FN, TYPEE, TYPEM, H)                  \
-+void HELPER(NAME)(CPUARMState *env, void *vg,              \
-+                  target_ulong addr, uint32_t desc)        \
-+{                                                          \
-+    intptr_t i, oprsz = simd_oprsz(desc);                  \
-+    intptr_t ra = GETPC();                                 \
-+    unsigned rd = simd_data(desc);                         \
-+    void *d1 = &env->vfp.zregs[rd];                        \
-+    void *d2 = &env->vfp.zregs[(rd + 1) & 31];             \
-+    void *d3 = &env->vfp.zregs[(rd + 2) & 31];             \
-+    void *d4 = &env->vfp.zregs[(rd + 3) & 31];             \
-+    for (i = 0; i < oprsz; ) {                             \
-+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));    \
-+        do {                                               \
-+            if (pg & 1) {                                  \
-+                TYPEM m1 = *(TYPEE *)(d1 + H(i));          \
-+                TYPEM m2 = *(TYPEE *)(d2 + H(i));          \
-+                TYPEM m3 = *(TYPEE *)(d3 + H(i));          \
-+                TYPEM m4 = *(TYPEE *)(d4 + H(i));          \
-+                FN(env, addr, m1, ra);                     \
-+                FN(env, addr + sizeof(TYPEM), m2, ra);     \
-+                FN(env, addr + 2 * sizeof(TYPEM), m3, ra); \
-+                FN(env, addr + 3 * sizeof(TYPEM), m4, ra); \
-+            }                                              \
-+            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);      \
-+            addr += 4 * sizeof(TYPEM);                     \
-+        } while (i & 15);                                  \
-+    }                                                      \
-+}
-+
-+DO_ST1(sve_st1bh_r, cpu_stb_data_ra, uint16_t, uint8_t, H1_2)
-+DO_ST1(sve_st1bs_r, cpu_stb_data_ra, uint32_t, uint8_t, H1_4)
-+DO_ST1_D(sve_st1bd_r, cpu_stb_data_ra, uint8_t)
-+
-+DO_ST1(sve_st1hs_r, cpu_stw_data_ra, uint32_t, uint16_t, H1_4)
-+DO_ST1_D(sve_st1hd_r, cpu_stw_data_ra, uint16_t)
-+
-+DO_ST1_D(sve_st1sd_r, cpu_stl_data_ra, uint32_t)
-+
-+DO_ST1(sve_st1bb_r, cpu_stb_data_ra, uint8_t, uint8_t, H1)
-+DO_ST2(sve_st2bb_r, cpu_stb_data_ra, uint8_t, uint8_t, H1)
-+DO_ST3(sve_st3bb_r, cpu_stb_data_ra, uint8_t, uint8_t, H1)
-+DO_ST4(sve_st4bb_r, cpu_stb_data_ra, uint8_t, uint8_t, H1)
-+
-+DO_ST1(sve_st1hh_r, cpu_stw_data_ra, uint16_t, uint16_t, H1_2)
-+DO_ST2(sve_st2hh_r, cpu_stw_data_ra, uint16_t, uint16_t, H1_2)
-+DO_ST3(sve_st3hh_r, cpu_stw_data_ra, uint16_t, uint16_t, H1_2)
-+DO_ST4(sve_st4hh_r, cpu_stw_data_ra, uint16_t, uint16_t, H1_2)
-+
-+DO_ST1(sve_st1ss_r, cpu_stl_data_ra, uint32_t, uint32_t, H1_4)
-+DO_ST2(sve_st2ss_r, cpu_stl_data_ra, uint32_t, uint32_t, H1_4)
-+DO_ST3(sve_st3ss_r, cpu_stl_data_ra, uint32_t, uint32_t, H1_4)
-+DO_ST4(sve_st4ss_r, cpu_stl_data_ra, uint32_t, uint32_t, H1_4)
-+
-+DO_ST1_D(sve_st1dd_r, cpu_stq_data_ra, uint64_t)
-+
-+void HELPER(sve_st2dd_r)(CPUARMState *env, void *vg,
-+                         target_ulong addr, uint32_t desc)
-+{
-+    intptr_t i, oprsz = simd_oprsz(desc) / 8;
-+    intptr_t ra = GETPC();
-+    unsigned rd = simd_data(desc);
-+    uint64_t *d1 = &env->vfp.zregs[rd].d[0];
-+    uint64_t *d2 = &env->vfp.zregs[(rd + 1) & 31].d[0];
-+    uint8_t *pg = vg;
-+
-+    for (i = 0; i < oprsz; i += 1) {
-+        if (pg[H1(i)] & 1) {
-+            cpu_stq_data_ra(env, addr, d1[i], ra);
-+            cpu_stq_data_ra(env, addr + 8, d2[i], ra);
-+        }
-+        addr += 2 * 8;
-+    }
-+}
-+
-+void HELPER(sve_st3dd_r)(CPUARMState *env, void *vg,
-+                         target_ulong addr, uint32_t desc)
-+{
-+    intptr_t i, oprsz = simd_oprsz(desc) / 8;
-+    intptr_t ra = GETPC();
-+    unsigned rd = simd_data(desc);
-+    uint64_t *d1 = &env->vfp.zregs[rd].d[0];
-+    uint64_t *d2 = &env->vfp.zregs[(rd + 1) & 31].d[0];
-+    uint64_t *d3 = &env->vfp.zregs[(rd + 2) & 31].d[0];
-+    uint8_t *pg = vg;
-+
-+    for (i = 0; i < oprsz; i += 1) {
-+        if (pg[H1(i)] & 1) {
-+            cpu_stq_data_ra(env, addr, d1[i], ra);
-+            cpu_stq_data_ra(env, addr + 8, d2[i], ra);
-+            cpu_stq_data_ra(env, addr + 16, d3[i], ra);
-+        }
-+        addr += 3 * 8;
-+    }
-+}
-+
-+void HELPER(sve_st4dd_r)(CPUARMState *env, void *vg,
-+                         target_ulong addr, uint32_t desc)
-+{
-+    intptr_t i, oprsz = simd_oprsz(desc) / 8;
-+    intptr_t ra = GETPC();
-+    unsigned rd = simd_data(desc);
-+    uint64_t *d1 = &env->vfp.zregs[rd].d[0];
-+    uint64_t *d2 = &env->vfp.zregs[(rd + 1) & 31].d[0];
-+    uint64_t *d3 = &env->vfp.zregs[(rd + 2) & 31].d[0];
-+    uint64_t *d4 = &env->vfp.zregs[(rd + 3) & 31].d[0];
-+    uint8_t *pg = vg;
-+
-+    for (i = 0; i < oprsz; i += 1) {
-+        if (pg[H1(i)] & 1) {
-+            cpu_stq_data_ra(env, addr, d1[i], ra);
-+            cpu_stq_data_ra(env, addr + 8, d2[i], ra);
-+            cpu_stq_data_ra(env, addr + 16, d3[i], ra);
-+            cpu_stq_data_ra(env, addr + 24, d4[i], ra);
-+        }
-+        addr += 4 * 8;
-+    }
-+}
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
-+++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static bool trans_LDNF1_zpri(DisasContext *s, arg_rpri_load *a, uint32_t insn)
-     }
-     return true;
- }
-+
-+static void do_st_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
-+                      int msz, int esz, int nreg)
-+{
-+    static gen_helper_gvec_mem * const fn_single[4][4] = {
-+        { gen_helper_sve_st1bb_r, gen_helper_sve_st1bh_r,
-+          gen_helper_sve_st1bs_r, gen_helper_sve_st1bd_r },
-+        { NULL,                   gen_helper_sve_st1hh_r,
-+          gen_helper_sve_st1hs_r, gen_helper_sve_st1hd_r },
-+        { NULL, NULL,
-+          gen_helper_sve_st1ss_r, gen_helper_sve_st1sd_r },
-+        { NULL, NULL, NULL, gen_helper_sve_st1dd_r },
-+    };
-+    static gen_helper_gvec_mem * const fn_multiple[3][4] = {
-+        { gen_helper_sve_st2bb_r, gen_helper_sve_st2hh_r,
-+          gen_helper_sve_st2ss_r, gen_helper_sve_st2dd_r },
-+        { gen_helper_sve_st3bb_r, gen_helper_sve_st3hh_r,
-+          gen_helper_sve_st3ss_r, gen_helper_sve_st3dd_r },
-+        { gen_helper_sve_st4bb_r, gen_helper_sve_st4hh_r,
-+          gen_helper_sve_st4ss_r, gen_helper_sve_st4dd_r },
-+    };
-+    gen_helper_gvec_mem *fn;
-+
-+    if (nreg == 0) {
-+        /* ST1 */
-+        fn = fn_single[msz][esz];
-+    } else {
-+        /* ST2, ST3, ST4 -- msz == esz, enforced by encoding */
-+        assert(msz == esz);
-+        fn = fn_multiple[nreg - 1][msz];
-+    }
-+    assert(fn != NULL);
-+    do_mem_zpa(s, zt, pg, addr, fn);
-+}
-+
-+static bool trans_ST_zprr(DisasContext *s, arg_rprr_store *a, uint32_t insn)
-+{
-+    if (a->rm == 31 || a->msz > a->esz) {
-+        return false;
-+    }
-+    if (sve_access_check(s)) {
-+        TCGv_i64 addr = new_tmp_a64(s);
-+        tcg_gen_muli_i64(addr, cpu_reg(s, a->rm), (a->nreg + 1) << a->msz);
-+        tcg_gen_add_i64(addr, addr, cpu_reg_sp(s, a->rn));
-+        do_st_zpa(s, a->rd, a->pg, addr, a->msz, a->esz, a->nreg);
-+    }
-+    return true;
-+}
-+
-+static bool trans_ST_zpri(DisasContext *s, arg_rpri_store *a, uint32_t insn)
-+{
-+    if (a->msz > a->esz) {
-+        return false;
-+    }
-+    if (sve_access_check(s)) {
-+        int vsz = vec_full_reg_size(s);
-+        int elements = vsz >> a->esz;
-+        TCGv_i64 addr = new_tmp_a64(s);
-+
-+        tcg_gen_addi_i64(addr, cpu_reg_sp(s, a->rn),
-+                         (a->imm * elements * (a->nreg + 1)) << a->msz);
-+        do_st_zpa(s, a->rd, a->pg, addr, a->msz, a->esz, a->nreg);
-+    }
-+    return true;
-+}
-diff --git a/target/arm/sve.decode b/target/arm/sve.decode
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
-+++ b/target/arm/sve.decode
-@@ -XXX,XX +XXX,XX @@
- %imm7_22_16     22:2 16:5
- %imm8_16_10     16:5 10:3
- %imm9_16_10     16:s6 10:3
-+%size_23        23:2
- # A combination of tsz:imm3 -- extract esize.
- %tszimm_esz     22:2 5:5 !function=tszimm_esz
-@@ -XXX,XX +XXX,XX @@
- &incdec2_pred   rd rn pg esz d u
- &rprr_load      rd pg rn rm dtype nreg
- &rpri_load      rd pg rn imm dtype nreg
-+&rprr_store     rd pg rn rm msz esz nreg
-+&rpri_store     rd pg rn imm msz esz nreg
- ###########################################################################
- # Named instruction formats.  These are generally used to
-@@ -XXX,XX +XXX,XX @@
- @rpri_load_msz  ....... .... . imm:s4 ... pg:3 rn:5 rd:5 \
-                 &rpri_load dtype=%msz_dtype
-+# Stores; user must fill in ESZ, MSZ, NREG as needed.
-+@rprr_store         ....... ..    ..     rm:5 ... pg:3 rn:5 rd:5    &rprr_store
-+@rpri_store_msz     ....... msz:2 .. . imm:s4 ... pg:3 rn:5 rd:5    &rpri_store
-+@rprr_store_esz_n0  ....... ..    esz:2  rm:5 ... pg:3 rn:5 rd:5 \
-+                    &rprr_store nreg=0
-+
- ###########################################################################
- # Instruction patterns.  Grouped according to the SVE encodingindex.xhtml.
-@@ -XXX,XX +XXX,XX @@ LD_zprr         1010010 .. nreg:2 ..... 110 ... ..... .....     @rprr_load_msz
- # SVE load multiple structures (scalar plus immediate)
- # LD2B, LD2H, LD2W, LD2D; etc.
- LD_zpri         1010010 .. nreg:2 0.... 111 ... ..... .....     @rpri_load_msz
-+
-+### SVE Memory Store Group
-+
-+# SVE contiguous store (scalar plus immediate)
-+# ST1B, ST1H, ST1W, ST1D; require msz <= esz
-+ST_zpri         1110010 .. esz:2  0.... 111 ... ..... ..... \
-+                @rpri_store_msz nreg=0
-+
-+# SVE contiguous store (scalar plus scalar)
-+# ST1B, ST1H, ST1W, ST1D; require msz <= esz
-+# Enumerate msz lest we conflict with STR_zri.
-+ST_zprr         1110010 00 ..     ..... 010 ... ..... ..... \
-+                @rprr_store_esz_n0 msz=0
-+ST_zprr         1110010 01 ..     ..... 010 ... ..... ..... \
-+                @rprr_store_esz_n0 msz=1
-+ST_zprr         1110010 10 ..     ..... 010 ... ..... ..... \
-+                @rprr_store_esz_n0 msz=2
-+ST_zprr         1110010 11 11     ..... 010 ... ..... ..... \
-+                @rprr_store msz=3 esz=3 nreg=0
-+
-+# SVE contiguous non-temporal store (scalar plus immediate)  (nreg == 0)
-+# SVE store multiple structures (scalar plus immediate)      (nreg != 0)
-+ST_zpri         1110010 .. nreg:2 1.... 111 ... ..... ..... \
-+                @rpri_store_msz esz=%size_23
-+
-+# SVE contiguous non-temporal store (scalar plus scalar)     (nreg == 0)
-+# SVE store multiple structures (scalar plus scalar)         (nreg != 0)
-+ST_zprr         1110010 msz:2 nreg:2 ..... 011 ... ..... ..... \
-+                @rprr_store esz=%size_23
---
-.17.1

-[Qemu-devel] [PULL 10/55] target/arm: Implement SVE load and broadcast quadword
+Deleted patch
-From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20180627043328.11531-5-richard.henderson@linaro.org
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
----
- target/arm/translate-sve.c | 52 ++++++++++++++++++++++++++++++++++++++
- target/arm/sve.decode      |  9 +++++++
-files changed, 61 insertions(+)
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
-+++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static bool trans_LDNF1_zpri(DisasContext *s, arg_rpri_load *a, uint32_t insn)
-     return true;
- }
-+static void do_ldrq(DisasContext *s, int zt, int pg, TCGv_i64 addr, int msz)
-+{
-+    static gen_helper_gvec_mem * const fns[4] = {
-+        gen_helper_sve_ld1bb_r, gen_helper_sve_ld1hh_r,
-+        gen_helper_sve_ld1ss_r, gen_helper_sve_ld1dd_r,
-+    };
-+    unsigned vsz = vec_full_reg_size(s);
-+    TCGv_ptr t_pg;
-+    TCGv_i32 desc;
-+
-+    /* Load the first quadword using the normal predicated load helpers.  */
-+    desc = tcg_const_i32(simd_desc(16, 16, zt));
-+    t_pg = tcg_temp_new_ptr();
-+
-+    tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, pg));
-+    fns[msz](cpu_env, t_pg, addr, desc);
-+
-+    tcg_temp_free_ptr(t_pg);
-+    tcg_temp_free_i32(desc);
-+
-+    /* Replicate that first quadword.  */
-+    if (vsz > 16) {
-+        unsigned dofs = vec_full_reg_offset(s, zt);
-+        tcg_gen_gvec_dup_mem(4, dofs + 16, dofs, vsz - 16, vsz - 16);
-+    }
-+}
-+
-+static bool trans_LD1RQ_zprr(DisasContext *s, arg_rprr_load *a, uint32_t insn)
-+{
-+    if (a->rm == 31) {
-+        return false;
-+    }
-+    if (sve_access_check(s)) {
-+        int msz = dtype_msz(a->dtype);
-+        TCGv_i64 addr = new_tmp_a64(s);
-+        tcg_gen_shli_i64(addr, cpu_reg(s, a->rm), msz);
-+        tcg_gen_add_i64(addr, addr, cpu_reg_sp(s, a->rn));
-+        do_ldrq(s, a->rd, a->pg, addr, msz);
-+    }
-+    return true;
-+}
-+
-+static bool trans_LD1RQ_zpri(DisasContext *s, arg_rpri_load *a, uint32_t insn)
-+{
-+    if (sve_access_check(s)) {
-+        TCGv_i64 addr = new_tmp_a64(s);
-+        tcg_gen_addi_i64(addr, cpu_reg_sp(s, a->rn), a->imm * 16);
-+        do_ldrq(s, a->rd, a->pg, addr, dtype_msz(a->dtype));
-+    }
-+    return true;
-+}
-+
- static void do_st_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
-                       int msz, int esz, int nreg)
- {
-diff --git a/target/arm/sve.decode b/target/arm/sve.decode
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
-+++ b/target/arm/sve.decode
-@@ -XXX,XX +XXX,XX @@ LD_zprr         1010010 .. nreg:2 ..... 110 ... ..... .....     @rprr_load_msz
- # LD2B, LD2H, LD2W, LD2D; etc.
- LD_zpri         1010010 .. nreg:2 0.... 111 ... ..... .....     @rpri_load_msz
-+# SVE load and broadcast quadword (scalar plus scalar)
-+LD1RQ_zprr      1010010 .. 00 ..... 000 ... ..... ..... \
-+                @rprr_load_msz nreg=0
-+
-+# SVE load and broadcast quadword (scalar plus immediate)
-+# LD1RQB, LD1RQH, LD1RQS, LD1RQD
-+LD1RQ_zpri      1010010 .. 00 0.... 001 ... ..... ..... \
-+                @rpri_load_msz nreg=0
-+
- ### SVE Memory Store Group
- # SVE contiguous store (scalar plus immediate)
---
-.17.1

-[Qemu-devel] [PULL 11/55] target/arm: Implement SVE integer convert to floating-point
+Deleted patch
-From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-[PMM: fixed typo]
-Message-id: 20180627043328.11531-6-richard.henderson@linaro.org
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
----
- target/arm/helper-sve.h    | 30 +++++++++++++
- target/arm/sve_helper.c    | 38 ++++++++++++++++
- target/arm/translate-sve.c | 90 ++++++++++++++++++++++++++++++++++++++
- target/arm/sve.decode      | 22 ++++++++++
-files changed, 180 insertions(+)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
-+++ b/target/arm/helper-sve.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_5(gvec_rsqrts_s, TCG_CALL_NO_RWG,
- DEF_HELPER_FLAGS_5(gvec_rsqrts_d, TCG_CALL_NO_RWG,
-                    void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_scvt_hh, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_scvt_sh, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_scvt_dh, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_scvt_ss, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_scvt_sd, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_scvt_ds, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_scvt_dd, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_5(sve_ucvt_hh, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_ucvt_sh, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_ucvt_dh, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_ucvt_ss, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_ucvt_sd, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_ucvt_ds, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_ucvt_dd, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+
- DEF_HELPER_FLAGS_4(sve_ld1bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
- DEF_HELPER_FLAGS_4(sve_ld2bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
- DEF_HELPER_FLAGS_4(sve_ld3bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
-diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve_helper.c
-+++ b/target/arm/sve_helper.c
-@@ -XXX,XX +XXX,XX @@ uint32_t HELPER(sve_while)(void *vd, uint32_t count, uint32_t pred_desc)
-     return predtest_ones(d, oprsz, esz_mask);
- }
-+/* Fully general two-operand expander, controlled by a predicate,
-+ * With the extra float_status parameter.
-+ */
-+#define DO_ZPZ_FP(NAME, TYPE, H, OP)                                  \
-+void HELPER(NAME)(void *vd, void *vn, void *vg, void *status, uint32_t desc) \
-+{                                                                     \
-+    intptr_t i = simd_oprsz(desc);                                    \
-+    uint64_t *g = vg;                                                 \
-+    do {                                                              \
-+        uint64_t pg = g[(i - 1) >> 6];                                \
-+        do {                                                          \
-+            i -= sizeof(TYPE);                                        \
-+            if (likely((pg >> (i & 63)) & 1)) {                       \
-+                TYPE nn = *(TYPE *)(vn + H(i));                       \
-+                *(TYPE *)(vd + H(i)) = OP(nn, status);                \
-+            }                                                         \
-+        } while (i & 63);                                             \
-+    } while (i != 0);                                                 \
-+}
-+
-+DO_ZPZ_FP(sve_scvt_hh, uint16_t, H1_2, int16_to_float16)
-+DO_ZPZ_FP(sve_scvt_sh, uint32_t, H1_4, int32_to_float16)
-+DO_ZPZ_FP(sve_scvt_ss, uint32_t, H1_4, int32_to_float32)
-+DO_ZPZ_FP(sve_scvt_sd, uint64_t,     , int32_to_float64)
-+DO_ZPZ_FP(sve_scvt_dh, uint64_t,     , int64_to_float16)
-+DO_ZPZ_FP(sve_scvt_ds, uint64_t,     , int64_to_float32)
-+DO_ZPZ_FP(sve_scvt_dd, uint64_t,     , int64_to_float64)
-+
-+DO_ZPZ_FP(sve_ucvt_hh, uint16_t, H1_2, uint16_to_float16)
-+DO_ZPZ_FP(sve_ucvt_sh, uint32_t, H1_4, uint32_to_float16)
-+DO_ZPZ_FP(sve_ucvt_ss, uint32_t, H1_4, uint32_to_float32)
-+DO_ZPZ_FP(sve_ucvt_sd, uint64_t,     , uint32_to_float64)
-+DO_ZPZ_FP(sve_ucvt_dh, uint64_t,     , uint64_to_float16)
-+DO_ZPZ_FP(sve_ucvt_ds, uint64_t,     , uint64_to_float32)
-+DO_ZPZ_FP(sve_ucvt_dd, uint64_t,     , uint64_to_float64)
-+
-+#undef DO_ZPZ_FP
-+
- /*
-  * Load contiguous data, protected by a governing predicate.
-  */
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
-+++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ DO_FP3(FRSQRTS, rsqrts)
- #undef DO_FP3
-+
-+/*
-+ *** SVE Floating Point Unary Operations Predicated Group
-+ */
-+
-+static bool do_zpz_ptr(DisasContext *s, int rd, int rn, int pg,
-+                       bool is_fp16, gen_helper_gvec_3_ptr *fn)
-+{
-+    if (sve_access_check(s)) {
-+        unsigned vsz = vec_full_reg_size(s);
-+        TCGv_ptr status = get_fpstatus_ptr(is_fp16);
-+        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, rd),
-+                           vec_full_reg_offset(s, rn),
-+                           pred_full_reg_offset(s, pg),
-+                           status, vsz, vsz, 0, fn);
-+        tcg_temp_free_ptr(status);
-+    }
-+    return true;
-+}
-+
-+static bool trans_SCVTF_hh(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_scvt_hh);
-+}
-+
-+static bool trans_SCVTF_sh(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_scvt_sh);
-+}
-+
-+static bool trans_SCVTF_dh(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_scvt_dh);
-+}
-+
-+static bool trans_SCVTF_ss(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_scvt_ss);
-+}
-+
-+static bool trans_SCVTF_ds(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_scvt_ds);
-+}
-+
-+static bool trans_SCVTF_sd(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_scvt_sd);
-+}
-+
-+static bool trans_SCVTF_dd(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_scvt_dd);
-+}
-+
-+static bool trans_UCVTF_hh(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_ucvt_hh);
-+}
-+
-+static bool trans_UCVTF_sh(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_ucvt_sh);
-+}
-+
-+static bool trans_UCVTF_dh(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_ucvt_dh);
-+}
-+
-+static bool trans_UCVTF_ss(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_ucvt_ss);
-+}
-+
-+static bool trans_UCVTF_ds(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_ucvt_ds);
-+}
-+
-+static bool trans_UCVTF_sd(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_ucvt_sd);
-+}
-+
-+static bool trans_UCVTF_dd(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_ucvt_dd);
-+}
-+
- /*
-  *** SVE Memory - 32-bit Gather and Unsized Contiguous Group
-  */
-diff --git a/target/arm/sve.decode b/target/arm/sve.decode
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
-+++ b/target/arm/sve.decode
-@@ -XXX,XX +XXX,XX @@
- @rd_pg_rn       ........ esz:2 ... ... ... pg:3 rn:5 rd:5       &rpr_esz
- @rd_pg4_pn      ........ esz:2 ... ... .. pg:4 . rn:4 rd:5      &rpr_esz
-+# One register operand, with governing predicate, no vector element size
-+@rd_pg_rn_e0    ........ .. ... ... ... pg:3 rn:5 rd:5          &rpr_esz esz=0
-+
- # Two register operands with a 6-bit signed immediate.
- @rd_rn_i6       ........ ... rn:5 ..... imm:s6 rd:5             &rri
-@@ -XXX,XX +XXX,XX @@ FTSMUL          01100101 .. 0 ..... 000 011 ..... .....         @rd_rn_rm
- FRECPS          01100101 .. 0 ..... 000 110 ..... .....         @rd_rn_rm
- FRSQRTS         01100101 .. 0 ..... 000 111 ..... .....         @rd_rn_rm
-+### SVE FP Unary Operations Predicated Group
-+
-+# SVE integer convert to floating-point
-+SCVTF_hh        01100101 01 010 01 0 101 ... ..... .....        @rd_pg_rn_e0
-+SCVTF_sh        01100101 01 010 10 0 101 ... ..... .....        @rd_pg_rn_e0
-+SCVTF_dh        01100101 01 010 11 0 101 ... ..... .....        @rd_pg_rn_e0
-+SCVTF_ss        01100101 10 010 10 0 101 ... ..... .....        @rd_pg_rn_e0
-+SCVTF_sd        01100101 11 010 00 0 101 ... ..... .....        @rd_pg_rn_e0
-+SCVTF_ds        01100101 11 010 10 0 101 ... ..... .....        @rd_pg_rn_e0
-+SCVTF_dd        01100101 11 010 11 0 101 ... ..... .....        @rd_pg_rn_e0
-+
-+UCVTF_hh        01100101 01 010 01 1 101 ... ..... .....        @rd_pg_rn_e0
-+UCVTF_sh        01100101 01 010 10 1 101 ... ..... .....        @rd_pg_rn_e0
-+UCVTF_dh        01100101 01 010 11 1 101 ... ..... .....        @rd_pg_rn_e0
-+UCVTF_ss        01100101 10 010 10 1 101 ... ..... .....        @rd_pg_rn_e0
-+UCVTF_sd        01100101 11 010 00 1 101 ... ..... .....        @rd_pg_rn_e0
-+UCVTF_ds        01100101 11 010 10 1 101 ... ..... .....        @rd_pg_rn_e0
-+UCVTF_dd        01100101 11 010 11 1 101 ... ..... .....        @rd_pg_rn_e0
-+
- ### SVE Memory - 32-bit Gather and Unsized Contiguous Group
- # SVE load predicate register
---
-.17.1

-[Qemu-devel] [PULL 12/55] target/arm: Implement SVE floating-point arithmetic (predicated)
+Deleted patch
-From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20180627043328.11531-7-richard.henderson@linaro.org
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
----
- target/arm/helper-sve.h    | 77 +++++++++++++++++++++++++++++++++
- target/arm/sve_helper.c    | 89 ++++++++++++++++++++++++++++++++++++++
- target/arm/translate-sve.c | 46 ++++++++++++++++++++
- target/arm/sve.decode      | 17 ++++++++
-files changed, 229 insertions(+)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
-+++ b/target/arm/helper-sve.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_5(gvec_rsqrts_s, TCG_CALL_NO_RWG,
- DEF_HELPER_FLAGS_5(gvec_rsqrts_d, TCG_CALL_NO_RWG,
-                    void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fadd_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fadd_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fadd_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fsub_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fsub_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fsub_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fmul_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmul_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmul_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fdiv_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fdiv_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fdiv_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fmin_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmin_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmin_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fmax_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmax_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmax_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fminnum_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fminnum_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fminnum_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fmaxnum_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmaxnum_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmaxnum_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fabd_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fabd_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fabd_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fscalbn_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fscalbn_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fscalbn_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fmulx_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmulx_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmulx_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
- DEF_HELPER_FLAGS_5(sve_scvt_hh, TCG_CALL_NO_RWG,
-                    void, ptr, ptr, ptr, ptr, i32)
- DEF_HELPER_FLAGS_5(sve_scvt_sh, TCG_CALL_NO_RWG,
-diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve_helper.c
-+++ b/target/arm/sve_helper.c
-@@ -XXX,XX +XXX,XX @@ uint32_t HELPER(sve_while)(void *vd, uint32_t count, uint32_t pred_desc)
-     return predtest_ones(d, oprsz, esz_mask);
- }
-+/* Fully general three-operand expander, controlled by a predicate,
-+ * With the extra float_status parameter.
-+ */
-+#define DO_ZPZZ_FP(NAME, TYPE, H, OP)                           \
-+void HELPER(NAME)(void *vd, void *vn, void *vm, void *vg,       \
-+                  void *status, uint32_t desc)                  \
-+{                                                               \
-+    intptr_t i = simd_oprsz(desc);                              \
-+    uint64_t *g = vg;                                           \
-+    do {                                                        \
-+        uint64_t pg = g[(i - 1) >> 6];                          \
-+        do {                                                    \
-+            i -= sizeof(TYPE);                                  \
-+            if (likely((pg >> (i & 63)) & 1)) {                 \
-+                TYPE nn = *(TYPE *)(vn + H(i));                 \
-+                TYPE mm = *(TYPE *)(vm + H(i));                 \
-+                *(TYPE *)(vd + H(i)) = OP(nn, mm, status);      \
-+            }                                                   \
-+        } while (i & 63);                                       \
-+    } while (i != 0);                                           \
-+}
-+
-+DO_ZPZZ_FP(sve_fadd_h, uint16_t, H1_2, float16_add)
-+DO_ZPZZ_FP(sve_fadd_s, uint32_t, H1_4, float32_add)
-+DO_ZPZZ_FP(sve_fadd_d, uint64_t,     , float64_add)
-+
-+DO_ZPZZ_FP(sve_fsub_h, uint16_t, H1_2, float16_sub)
-+DO_ZPZZ_FP(sve_fsub_s, uint32_t, H1_4, float32_sub)
-+DO_ZPZZ_FP(sve_fsub_d, uint64_t,     , float64_sub)
-+
-+DO_ZPZZ_FP(sve_fmul_h, uint16_t, H1_2, float16_mul)
-+DO_ZPZZ_FP(sve_fmul_s, uint32_t, H1_4, float32_mul)
-+DO_ZPZZ_FP(sve_fmul_d, uint64_t,     , float64_mul)
-+
-+DO_ZPZZ_FP(sve_fdiv_h, uint16_t, H1_2, float16_div)
-+DO_ZPZZ_FP(sve_fdiv_s, uint32_t, H1_4, float32_div)
-+DO_ZPZZ_FP(sve_fdiv_d, uint64_t,     , float64_div)
-+
-+DO_ZPZZ_FP(sve_fmin_h, uint16_t, H1_2, float16_min)
-+DO_ZPZZ_FP(sve_fmin_s, uint32_t, H1_4, float32_min)
-+DO_ZPZZ_FP(sve_fmin_d, uint64_t,     , float64_min)
-+
-+DO_ZPZZ_FP(sve_fmax_h, uint16_t, H1_2, float16_max)
-+DO_ZPZZ_FP(sve_fmax_s, uint32_t, H1_4, float32_max)
-+DO_ZPZZ_FP(sve_fmax_d, uint64_t,     , float64_max)
-+
-+DO_ZPZZ_FP(sve_fminnum_h, uint16_t, H1_2, float16_minnum)
-+DO_ZPZZ_FP(sve_fminnum_s, uint32_t, H1_4, float32_minnum)
-+DO_ZPZZ_FP(sve_fminnum_d, uint64_t,     , float64_minnum)
-+
-+DO_ZPZZ_FP(sve_fmaxnum_h, uint16_t, H1_2, float16_maxnum)
-+DO_ZPZZ_FP(sve_fmaxnum_s, uint32_t, H1_4, float32_maxnum)
-+DO_ZPZZ_FP(sve_fmaxnum_d, uint64_t,     , float64_maxnum)
-+
-+static inline float16 abd_h(float16 a, float16 b, float_status *s)
-+{
-+    return float16_abs(float16_sub(a, b, s));
-+}
-+
-+static inline float32 abd_s(float32 a, float32 b, float_status *s)
-+{
-+    return float32_abs(float32_sub(a, b, s));
-+}
-+
-+static inline float64 abd_d(float64 a, float64 b, float_status *s)
-+{
-+    return float64_abs(float64_sub(a, b, s));
-+}
-+
-+DO_ZPZZ_FP(sve_fabd_h, uint16_t, H1_2, abd_h)
-+DO_ZPZZ_FP(sve_fabd_s, uint32_t, H1_4, abd_s)
-+DO_ZPZZ_FP(sve_fabd_d, uint64_t,     , abd_d)
-+
-+static inline float64 scalbn_d(float64 a, int64_t b, float_status *s)
-+{
-+    int b_int = MIN(MAX(b, INT_MIN), INT_MAX);
-+    return float64_scalbn(a, b_int, s);
-+}
-+
-+DO_ZPZZ_FP(sve_fscalbn_h, int16_t, H1_2, float16_scalbn)
-+DO_ZPZZ_FP(sve_fscalbn_s, int32_t, H1_4, float32_scalbn)
-+DO_ZPZZ_FP(sve_fscalbn_d, int64_t,     , scalbn_d)
-+
-+DO_ZPZZ_FP(sve_fmulx_h, uint16_t, H1_2, helper_advsimd_mulxh)
-+DO_ZPZZ_FP(sve_fmulx_s, uint32_t, H1_4, helper_vfp_mulxs)
-+DO_ZPZZ_FP(sve_fmulx_d, uint64_t,     , helper_vfp_mulxd)
-+
-+#undef DO_ZPZZ_FP
-+
- /* Fully general two-operand expander, controlled by a predicate,
-  * With the extra float_status parameter.
-  */
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
-+++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ DO_FP3(FRSQRTS, rsqrts)
- #undef DO_FP3
-+/*
-+ *** SVE Floating Point Arithmetic - Predicated Group
-+ */
-+
-+static bool do_zpzz_fp(DisasContext *s, arg_rprr_esz *a,
-+                       gen_helper_gvec_4_ptr *fn)
-+{
-+    if (fn == NULL) {
-+        return false;
-+    }
-+    if (sve_access_check(s)) {
-+        unsigned vsz = vec_full_reg_size(s);
-+        TCGv_ptr status = get_fpstatus_ptr(a->esz == MO_16);
-+        tcg_gen_gvec_4_ptr(vec_full_reg_offset(s, a->rd),
-+                           vec_full_reg_offset(s, a->rn),
-+                           vec_full_reg_offset(s, a->rm),
-+                           pred_full_reg_offset(s, a->pg),
-+                           status, vsz, vsz, 0, fn);
-+        tcg_temp_free_ptr(status);
-+    }
-+    return true;
-+}
-+
-+#define DO_FP3(NAME, name) \
-+static bool trans_##NAME(DisasContext *s, arg_rprr_esz *a, uint32_t insn) \
-+{                                                                   \
-+    static gen_helper_gvec_4_ptr * const fns[4] = {                 \
-+        NULL, gen_helper_sve_##name##_h,                            \
-+        gen_helper_sve_##name##_s, gen_helper_sve_##name##_d        \
-+    };                                                              \
-+    return do_zpzz_fp(s, a, fns[a->esz]);                           \
-+}
-+
-+DO_FP3(FADD_zpzz, fadd)
-+DO_FP3(FSUB_zpzz, fsub)
-+DO_FP3(FMUL_zpzz, fmul)
-+DO_FP3(FMIN_zpzz, fmin)
-+DO_FP3(FMAX_zpzz, fmax)
-+DO_FP3(FMINNM_zpzz, fminnum)
-+DO_FP3(FMAXNM_zpzz, fmaxnum)
-+DO_FP3(FABD, fabd)
-+DO_FP3(FSCALE, fscalbn)
-+DO_FP3(FDIV, fdiv)
-+DO_FP3(FMULX, fmulx)
-+
-+#undef DO_FP3
- /*
-  *** SVE Floating Point Unary Operations Predicated Group
-diff --git a/target/arm/sve.decode b/target/arm/sve.decode
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
-+++ b/target/arm/sve.decode
-@@ -XXX,XX +XXX,XX @@ FTSMUL          01100101 .. 0 ..... 000 011 ..... .....         @rd_rn_rm
- FRECPS          01100101 .. 0 ..... 000 110 ..... .....         @rd_rn_rm
- FRSQRTS         01100101 .. 0 ..... 000 111 ..... .....         @rd_rn_rm
-+### SVE FP Arithmetic Predicated Group
-+
-+# SVE floating-point arithmetic (predicated)
-+FADD_zpzz       01100101 .. 00 0000 100 ... ..... .....    @rdn_pg_rm
-+FSUB_zpzz       01100101 .. 00 0001 100 ... ..... .....    @rdn_pg_rm
-+FMUL_zpzz       01100101 .. 00 0010 100 ... ..... .....    @rdn_pg_rm
-+FSUB_zpzz       01100101 .. 00 0011 100 ... ..... .....    @rdm_pg_rn # FSUBR
-+FMAXNM_zpzz     01100101 .. 00 0100 100 ... ..... .....    @rdn_pg_rm
-+FMINNM_zpzz     01100101 .. 00 0101 100 ... ..... .....    @rdn_pg_rm
-+FMAX_zpzz       01100101 .. 00 0110 100 ... ..... .....    @rdn_pg_rm
-+FMIN_zpzz       01100101 .. 00 0111 100 ... ..... .....    @rdn_pg_rm
-+FABD            01100101 .. 00 1000 100 ... ..... .....    @rdn_pg_rm
-+FSCALE          01100101 .. 00 1001 100 ... ..... .....    @rdn_pg_rm
-+FMULX           01100101 .. 00 1010 100 ... ..... .....    @rdn_pg_rm
-+FDIV            01100101 .. 00 1100 100 ... ..... .....    @rdm_pg_rn # FDIVR
-+FDIV            01100101 .. 00 1101 100 ... ..... .....    @rdn_pg_rm
-+
- ### SVE FP Unary Operations Predicated Group
- # SVE integer convert to floating-point
---
-.17.1

-[Qemu-devel] [PULL 22/55] target/arm: Implement SVE floating-point compare vectors
+Deleted patch
-From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20180627043328.11531-17-richard.henderson@linaro.org
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
----
- target/arm/helper-sve.h    | 49 ++++++++++++++++++++++++++++++
- target/arm/sve_helper.c    | 62 ++++++++++++++++++++++++++++++++++++++
- target/arm/translate-sve.c | 40 ++++++++++++++++++++++++
- target/arm/sve.decode      | 11 +++++++
-files changed, 162 insertions(+)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
-+++ b/target/arm/helper-sve.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_5(sve_ucvt_ds, TCG_CALL_NO_RWG,
- DEF_HELPER_FLAGS_5(sve_ucvt_dd, TCG_CALL_NO_RWG,
-                    void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fcmge_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fcmge_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fcmge_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fcmgt_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fcmgt_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fcmgt_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fcmeq_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fcmeq_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fcmeq_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fcmne_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fcmne_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fcmne_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fcmuo_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fcmuo_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fcmuo_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_facge_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_facge_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_facge_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_facgt_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_facgt_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_facgt_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, ptr, i32)
-+
- DEF_HELPER_FLAGS_3(sve_fmla_zpzzz_h, TCG_CALL_NO_RWG, void, env, ptr, i32)
- DEF_HELPER_FLAGS_3(sve_fmla_zpzzz_s, TCG_CALL_NO_RWG, void, env, ptr, i32)
- DEF_HELPER_FLAGS_3(sve_fmla_zpzzz_d, TCG_CALL_NO_RWG, void, env, ptr, i32)
-diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve_helper.c
-+++ b/target/arm/sve_helper.c
-@@ -XXX,XX +XXX,XX @@ void HELPER(sve_fnmls_zpzzz_d)(CPUARMState *env, void *vg, uint32_t desc)
-     do_fmla_zpzzz_d(env, vg, desc, 0, INT64_MIN);
- }
-+/* Two operand floating-point comparison controlled by a predicate.
-+ * Unlike the integer version, we are not allowed to optimistically
-+ * compare operands, since the comparison may have side effects wrt
-+ * the FPSR.
-+ */
-+#define DO_FPCMP_PPZZ(NAME, TYPE, H, OP)                                \
-+void HELPER(NAME)(void *vd, void *vn, void *vm, void *vg,               \
-+                  void *status, uint32_t desc)                          \
-+{                                                                       \
-+    intptr_t i = simd_oprsz(desc), j = (i - 1) >> 6;                    \
-+    uint64_t *d = vd, *g = vg;                                          \
-+    do {                                                                \
-+        uint64_t out = 0, pg = g[j];                                    \
-+        do {                                                            \
-+            i -= sizeof(TYPE), out <<= sizeof(TYPE);                    \
-+            if (likely((pg >> (i & 63)) & 1)) {                         \
-+                TYPE nn = *(TYPE *)(vn + H(i));                         \
-+                TYPE mm = *(TYPE *)(vm + H(i));                         \
-+                out |= OP(TYPE, nn, mm, status);                        \
-+            }                                                           \
-+        } while (i & 63);                                               \
-+        d[j--] = out;                                                   \
-+    } while (i > 0);                                                    \
-+}
-+
-+#define DO_FPCMP_PPZZ_H(NAME, OP) \
-+    DO_FPCMP_PPZZ(NAME##_h, float16, H1_2, OP)
-+#define DO_FPCMP_PPZZ_S(NAME, OP) \
-+    DO_FPCMP_PPZZ(NAME##_s, float32, H1_4, OP)
-+#define DO_FPCMP_PPZZ_D(NAME, OP) \
-+    DO_FPCMP_PPZZ(NAME##_d, float64,     , OP)
-+
-+#define DO_FPCMP_PPZZ_ALL(NAME, OP) \
-+    DO_FPCMP_PPZZ_H(NAME, OP)   \
-+    DO_FPCMP_PPZZ_S(NAME, OP)   \
-+    DO_FPCMP_PPZZ_D(NAME, OP)
-+
-+#define DO_FCMGE(TYPE, X, Y, ST)  TYPE##_compare(Y, X, ST) <= 0
-+#define DO_FCMGT(TYPE, X, Y, ST)  TYPE##_compare(Y, X, ST) < 0
-+#define DO_FCMEQ(TYPE, X, Y, ST)  TYPE##_compare_quiet(X, Y, ST) == 0
-+#define DO_FCMNE(TYPE, X, Y, ST)  TYPE##_compare_quiet(X, Y, ST) != 0
-+#define DO_FCMUO(TYPE, X, Y, ST)  \
-+    TYPE##_compare_quiet(X, Y, ST) == float_relation_unordered
-+#define DO_FACGE(TYPE, X, Y, ST)  \
-+    TYPE##_compare(TYPE##_abs(Y), TYPE##_abs(X), ST) <= 0
-+#define DO_FACGT(TYPE, X, Y, ST)  \
-+    TYPE##_compare(TYPE##_abs(Y), TYPE##_abs(X), ST) < 0
-+
-+DO_FPCMP_PPZZ_ALL(sve_fcmge, DO_FCMGE)
-+DO_FPCMP_PPZZ_ALL(sve_fcmgt, DO_FCMGT)
-+DO_FPCMP_PPZZ_ALL(sve_fcmeq, DO_FCMEQ)
-+DO_FPCMP_PPZZ_ALL(sve_fcmne, DO_FCMNE)
-+DO_FPCMP_PPZZ_ALL(sve_fcmuo, DO_FCMUO)
-+DO_FPCMP_PPZZ_ALL(sve_facge, DO_FACGE)
-+DO_FPCMP_PPZZ_ALL(sve_facgt, DO_FACGT)
-+
-+#undef DO_FPCMP_PPZZ_ALL
-+#undef DO_FPCMP_PPZZ_D
-+#undef DO_FPCMP_PPZZ_S
-+#undef DO_FPCMP_PPZZ_H
-+#undef DO_FPCMP_PPZZ
-+
- /*
-  * Load contiguous data, protected by a governing predicate.
-  */
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
-+++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ DO_FP3(FMULX, fmulx)
- #undef DO_FP3
-+static bool do_fp_cmp(DisasContext *s, arg_rprr_esz *a,
-+                      gen_helper_gvec_4_ptr *fn)
-+{
-+    if (fn == NULL) {
-+        return false;
-+    }
-+    if (sve_access_check(s)) {
-+        unsigned vsz = vec_full_reg_size(s);
-+        TCGv_ptr status = get_fpstatus_ptr(a->esz == MO_16);
-+        tcg_gen_gvec_4_ptr(pred_full_reg_offset(s, a->rd),
-+                           vec_full_reg_offset(s, a->rn),
-+                           vec_full_reg_offset(s, a->rm),
-+                           pred_full_reg_offset(s, a->pg),
-+                           status, vsz, vsz, 0, fn);
-+        tcg_temp_free_ptr(status);
-+    }
-+    return true;
-+}
-+
-+#define DO_FPCMP(NAME, name) \
-+static bool trans_##NAME##_ppzz(DisasContext *s, arg_rprr_esz *a,     \
-+                                uint32_t insn)                        \
-+{                                                                     \
-+    static gen_helper_gvec_4_ptr * const fns[4] = {                   \
-+        NULL, gen_helper_sve_##name##_h,                              \
-+        gen_helper_sve_##name##_s, gen_helper_sve_##name##_d          \
-+    };                                                                \
-+    return do_fp_cmp(s, a, fns[a->esz]);                              \
-+}
-+
-+DO_FPCMP(FCMGE, fcmge)
-+DO_FPCMP(FCMGT, fcmgt)
-+DO_FPCMP(FCMEQ, fcmeq)
-+DO_FPCMP(FCMNE, fcmne)
-+DO_FPCMP(FCMUO, fcmuo)
-+DO_FPCMP(FACGE, facge)
-+DO_FPCMP(FACGT, facgt)
-+
-+#undef DO_FPCMP
-+
- typedef void gen_helper_sve_fmla(TCGv_env, TCGv_ptr, TCGv_i32);
- static bool do_fmla(DisasContext *s, arg_rprrr_esz *a, gen_helper_sve_fmla *fn)
-diff --git a/target/arm/sve.decode b/target/arm/sve.decode
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
-+++ b/target/arm/sve.decode
-@@ -XXX,XX +XXX,XX @@ UXTH            00000100 .. 010 011 101 ... ..... .....         @rd_pg_rn
- SXTW            00000100 .. 010 100 101 ... ..... .....         @rd_pg_rn
- UXTW            00000100 .. 010 101 101 ... ..... .....         @rd_pg_rn
-+### SVE Floating Point Compare - Vectors Group
-+
-+# SVE floating-point compare vectors
-+FCMGE_ppzz      01100101 .. 0 ..... 010 ... ..... 0 ....        @pd_pg_rn_rm
-+FCMGT_ppzz      01100101 .. 0 ..... 010 ... ..... 1 ....        @pd_pg_rn_rm
-+FCMEQ_ppzz      01100101 .. 0 ..... 011 ... ..... 0 ....        @pd_pg_rn_rm
-+FCMNE_ppzz      01100101 .. 0 ..... 011 ... ..... 1 ....        @pd_pg_rn_rm
-+FCMUO_ppzz      01100101 .. 0 ..... 110 ... ..... 0 ....        @pd_pg_rn_rm
-+FACGE_ppzz      01100101 .. 0 ..... 110 ... ..... 1 ....        @pd_pg_rn_rm
-+FACGT_ppzz      01100101 .. 0 ..... 111 ... ..... 1 ....        @pd_pg_rn_rm
-+
- ### SVE Integer Multiply-Add Group
- # SVE integer multiply-add writing addend (predicated)
---
-.17.1

-[Qemu-devel] [PULL 23/55] target/arm: Implement SVE floating-point arithmetic with immediate
+Deleted patch
-From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20180627043328.11531-18-richard.henderson@linaro.org
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
----
- target/arm/helper-sve.h    | 56 ++++++++++++++++++++++++++++
- target/arm/sve_helper.c    | 69 +++++++++++++++++++++++++++++++++++
- target/arm/translate-sve.c | 75 ++++++++++++++++++++++++++++++++++++++
- target/arm/sve.decode      | 14 +++++++
-files changed, 214 insertions(+)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
-+++ b/target/arm/helper-sve.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_6(sve_fmulx_s, TCG_CALL_NO_RWG,
- DEF_HELPER_FLAGS_6(sve_fmulx_d, TCG_CALL_NO_RWG,
-                    void, ptr, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fadds_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fadds_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fadds_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fsubs_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fsubs_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fsubs_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fmuls_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmuls_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmuls_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fsubrs_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fsubrs_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fsubrs_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fmaxnms_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmaxnms_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmaxnms_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fminnms_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fminnms_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fminnms_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fmaxs_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmaxs_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmaxs_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+
-+DEF_HELPER_FLAGS_6(sve_fmins_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmins_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+DEF_HELPER_FLAGS_6(sve_fmins_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, i64, ptr, i32)
-+
- DEF_HELPER_FLAGS_5(sve_scvt_hh, TCG_CALL_NO_RWG,
-                    void, ptr, ptr, ptr, ptr, i32)
- DEF_HELPER_FLAGS_5(sve_scvt_sh, TCG_CALL_NO_RWG,
-diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve_helper.c
-+++ b/target/arm/sve_helper.c
-@@ -XXX,XX +XXX,XX @@ DO_ZPZZ_FP(sve_fmulx_d, uint64_t,     , helper_vfp_mulxd)
- #undef DO_ZPZZ_FP
-+/* Three-operand expander, with one scalar operand, controlled by
-+ * a predicate, with the extra float_status parameter.
-+ */
-+#define DO_ZPZS_FP(NAME, TYPE, H, OP) \
-+void HELPER(NAME)(void *vd, void *vn, void *vg, uint64_t scalar,  \
-+                  void *status, uint32_t desc)                    \
-+{                                                                 \
-+    intptr_t i = simd_oprsz(desc);                                \
-+    uint64_t *g = vg;                                             \
-+    TYPE mm = scalar;                                             \
-+    do {                                                          \
-+        uint64_t pg = g[(i - 1) >> 6];                            \
-+        do {                                                      \
-+            i -= sizeof(TYPE);                                    \
-+            if (likely((pg >> (i & 63)) & 1)) {                   \
-+                TYPE nn = *(TYPE *)(vn + H(i));                   \
-+                *(TYPE *)(vd + H(i)) = OP(nn, mm, status);        \
-+            }                                                     \
-+        } while (i & 63);                                         \
-+    } while (i != 0);                                             \
-+}
-+
-+DO_ZPZS_FP(sve_fadds_h, float16, H1_2, float16_add)
-+DO_ZPZS_FP(sve_fadds_s, float32, H1_4, float32_add)
-+DO_ZPZS_FP(sve_fadds_d, float64,     , float64_add)
-+
-+DO_ZPZS_FP(sve_fsubs_h, float16, H1_2, float16_sub)
-+DO_ZPZS_FP(sve_fsubs_s, float32, H1_4, float32_sub)
-+DO_ZPZS_FP(sve_fsubs_d, float64,     , float64_sub)
-+
-+DO_ZPZS_FP(sve_fmuls_h, float16, H1_2, float16_mul)
-+DO_ZPZS_FP(sve_fmuls_s, float32, H1_4, float32_mul)
-+DO_ZPZS_FP(sve_fmuls_d, float64,     , float64_mul)
-+
-+static inline float16 subr_h(float16 a, float16 b, float_status *s)
-+{
-+    return float16_sub(b, a, s);
-+}
-+
-+static inline float32 subr_s(float32 a, float32 b, float_status *s)
-+{
-+    return float32_sub(b, a, s);
-+}
-+
-+static inline float64 subr_d(float64 a, float64 b, float_status *s)
-+{
-+    return float64_sub(b, a, s);
-+}
-+
-+DO_ZPZS_FP(sve_fsubrs_h, float16, H1_2, subr_h)
-+DO_ZPZS_FP(sve_fsubrs_s, float32, H1_4, subr_s)
-+DO_ZPZS_FP(sve_fsubrs_d, float64,     , subr_d)
-+
-+DO_ZPZS_FP(sve_fmaxnms_h, float16, H1_2, float16_maxnum)
-+DO_ZPZS_FP(sve_fmaxnms_s, float32, H1_4, float32_maxnum)
-+DO_ZPZS_FP(sve_fmaxnms_d, float64,     , float64_maxnum)
-+
-+DO_ZPZS_FP(sve_fminnms_h, float16, H1_2, float16_minnum)
-+DO_ZPZS_FP(sve_fminnms_s, float32, H1_4, float32_minnum)
-+DO_ZPZS_FP(sve_fminnms_d, float64,     , float64_minnum)
-+
-+DO_ZPZS_FP(sve_fmaxs_h, float16, H1_2, float16_max)
-+DO_ZPZS_FP(sve_fmaxs_s, float32, H1_4, float32_max)
-+DO_ZPZS_FP(sve_fmaxs_d, float64,     , float64_max)
-+
-+DO_ZPZS_FP(sve_fmins_h, float16, H1_2, float16_min)
-+DO_ZPZS_FP(sve_fmins_s, float32, H1_4, float32_min)
-+DO_ZPZS_FP(sve_fmins_d, float64,     , float64_min)
-+
- /* Fully general two-operand expander, controlled by a predicate,
-  * With the extra float_status parameter.
-  */
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
-+++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@
- #include "exec/log.h"
- #include "trace-tcg.h"
- #include "translate-a64.h"
-+#include "fpu/softfloat.h"
- typedef void GVecGen2sFn(unsigned, uint32_t, uint32_t,
-@@ -XXX,XX +XXX,XX @@ DO_FP3(FMULX, fmulx)
- #undef DO_FP3
-+typedef void gen_helper_sve_fp2scalar(TCGv_ptr, TCGv_ptr, TCGv_ptr,
-+                                      TCGv_i64, TCGv_ptr, TCGv_i32);
-+
-+static void do_fp_scalar(DisasContext *s, int zd, int zn, int pg, bool is_fp16,
-+                         TCGv_i64 scalar, gen_helper_sve_fp2scalar *fn)
-+{
-+    unsigned vsz = vec_full_reg_size(s);
-+    TCGv_ptr t_zd, t_zn, t_pg, status;
-+    TCGv_i32 desc;
-+
-+    t_zd = tcg_temp_new_ptr();
-+    t_zn = tcg_temp_new_ptr();
-+    t_pg = tcg_temp_new_ptr();
-+    tcg_gen_addi_ptr(t_zd, cpu_env, vec_full_reg_offset(s, zd));
-+    tcg_gen_addi_ptr(t_zn, cpu_env, vec_full_reg_offset(s, zn));
-+    tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, pg));
-+
-+    status = get_fpstatus_ptr(is_fp16);
-+    desc = tcg_const_i32(simd_desc(vsz, vsz, 0));
-+    fn(t_zd, t_zn, t_pg, scalar, status, desc);
-+
-+    tcg_temp_free_i32(desc);
-+    tcg_temp_free_ptr(status);
-+    tcg_temp_free_ptr(t_pg);
-+    tcg_temp_free_ptr(t_zn);
-+    tcg_temp_free_ptr(t_zd);
-+}
-+
-+static void do_fp_imm(DisasContext *s, arg_rpri_esz *a, uint64_t imm,
-+                      gen_helper_sve_fp2scalar *fn)
-+{
-+    TCGv_i64 temp = tcg_const_i64(imm);
-+    do_fp_scalar(s, a->rd, a->rn, a->pg, a->esz == MO_16, temp, fn);
-+    tcg_temp_free_i64(temp);
-+}
-+
-+#define DO_FP_IMM(NAME, name, const0, const1) \
-+static bool trans_##NAME##_zpzi(DisasContext *s, arg_rpri_esz *a,         \
-+                                uint32_t insn)                            \
-+{                                                                         \
-+    static gen_helper_sve_fp2scalar * const fns[3] = {                    \
-+        gen_helper_sve_##name##_h,                                        \
-+        gen_helper_sve_##name##_s,                                        \
-+        gen_helper_sve_##name##_d                                         \
-+    };                                                                    \
-+    static uint64_t const val[3][2] = {                                   \
-+        { float16_##const0, float16_##const1 },                           \
-+        { float32_##const0, float32_##const1 },                           \
-+        { float64_##const0, float64_##const1 },                           \
-+    };                                                                    \
-+    if (a->esz == 0) {                                                    \
-+        return false;                                                     \
-+    }                                                                     \
-+    if (sve_access_check(s)) {                                            \
-+        do_fp_imm(s, a, val[a->esz - 1][a->imm], fns[a->esz - 1]);        \
-+    }                                                                     \
-+    return true;                                                          \
-+}
-+
-+#define float16_two  make_float16(0x4000)
-+#define float32_two  make_float32(0x40000000)
-+#define float64_two  make_float64(0x4000000000000000ULL)
-+
-+DO_FP_IMM(FADD, fadds, half, one)
-+DO_FP_IMM(FSUB, fsubs, half, one)
-+DO_FP_IMM(FMUL, fmuls, half, two)
-+DO_FP_IMM(FSUBR, fsubrs, half, one)
-+DO_FP_IMM(FMAXNM, fmaxnms, zero, one)
-+DO_FP_IMM(FMINNM, fminnms, zero, one)
-+DO_FP_IMM(FMAX, fmaxs, zero, one)
-+DO_FP_IMM(FMIN, fmins, zero, one)
-+
-+#undef DO_FP_IMM
-+
- static bool do_fp_cmp(DisasContext *s, arg_rprr_esz *a,
-                       gen_helper_gvec_4_ptr *fn)
- {
-diff --git a/target/arm/sve.decode b/target/arm/sve.decode
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
-+++ b/target/arm/sve.decode
-@@ -XXX,XX +XXX,XX @@
- @rdn_pg4        ........ esz:2 .. pg:4 ... ........ rd:5 \
-                 &rpri_esz rn=%reg_movprfx
-+# Two register operand, one one-bit floating-point operand.
-+@rdn_i1         ........ esz:2 ......... pg:3 .... imm:1 rd:5 \
-+                &rpri_esz rn=%reg_movprfx
-+
- # Two register operand, one encoded bitmask.
- @rdn_dbm        ........ .. .... dbm:13 rd:5 \
-                 &rr_dbm rn=%reg_movprfx
-@@ -XXX,XX +XXX,XX @@ FMULX           01100101 .. 00 1010 100 ... ..... .....    @rdn_pg_rm
- FDIV            01100101 .. 00 1100 100 ... ..... .....    @rdm_pg_rn # FDIVR
- FDIV            01100101 .. 00 1101 100 ... ..... .....    @rdn_pg_rm
-+# SVE floating-point arithmetic with immediate (predicated)
-+FADD_zpzi       01100101 .. 011 000 100 ... 0000 . .....        @rdn_i1
-+FSUB_zpzi       01100101 .. 011 001 100 ... 0000 . .....        @rdn_i1
-+FMUL_zpzi       01100101 .. 011 010 100 ... 0000 . .....        @rdn_i1
-+FSUBR_zpzi      01100101 .. 011 011 100 ... 0000 . .....        @rdn_i1
-+FMAXNM_zpzi     01100101 .. 011 100 100 ... 0000 . .....        @rdn_i1
-+FMINNM_zpzi     01100101 .. 011 101 100 ... 0000 . .....        @rdn_i1
-+FMAX_zpzi       01100101 .. 011 110 100 ... 0000 . .....        @rdn_i1
-+FMIN_zpzi       01100101 .. 011 111 100 ... 0000 . .....        @rdn_i1
-+
- ### SVE FP Multiply-Add Group
- # SVE floating-point multiply-accumulate writing addend
---
-.17.1

-[Qemu-devel] [PULL 29/55] target/arm: Implement SVE floating-point convert precision
+Deleted patch
-From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20180627043328.11531-24-richard.henderson@linaro.org
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
----
- target/arm/helper-sve.h    | 13 +++++++++
- target/arm/sve_helper.c    | 55 ++++++++++++++++++++++++++++++++++++++
- target/arm/translate-sve.c | 30 +++++++++++++++++++++
- target/arm/sve.decode      |  8 ++++++
-files changed, 106 insertions(+)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
-+++ b/target/arm/helper-sve.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_6(sve_fmins_s, TCG_CALL_NO_RWG,
- DEF_HELPER_FLAGS_6(sve_fmins_d, TCG_CALL_NO_RWG,
-                    void, ptr, ptr, ptr, i64, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_fcvt_sh, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_fcvt_dh, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_fcvt_hs, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_fcvt_ds, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_fcvt_hd, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_fcvt_sd, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+
- DEF_HELPER_FLAGS_5(sve_scvt_hh, TCG_CALL_NO_RWG,
-                    void, ptr, ptr, ptr, ptr, i32)
- DEF_HELPER_FLAGS_5(sve_scvt_sh, TCG_CALL_NO_RWG,
-diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve_helper.c
-+++ b/target/arm/sve_helper.c
-@@ -XXX,XX +XXX,XX @@ void HELPER(NAME)(void *vd, void *vn, void *vg, void *status, uint32_t desc) \
-     } while (i != 0);                                                 \
- }
-+/* SVE fp16 conversions always use IEEE mode.  Like AdvSIMD, they ignore
-+ * FZ16.  When converting from fp16, this affects flushing input denormals;
-+ * when converting to fp16, this affects flushing output denormals.
-+ */
-+static inline float32 sve_f16_to_f32(float16 f, float_status *fpst)
-+{
-+    flag save = get_flush_inputs_to_zero(fpst);
-+    float32 ret;
-+
-+    set_flush_inputs_to_zero(false, fpst);
-+    ret = float16_to_float32(f, true, fpst);
-+    set_flush_inputs_to_zero(save, fpst);
-+    return ret;
-+}
-+
-+static inline float64 sve_f16_to_f64(float16 f, float_status *fpst)
-+{
-+    flag save = get_flush_inputs_to_zero(fpst);
-+    float64 ret;
-+
-+    set_flush_inputs_to_zero(false, fpst);
-+    ret = float16_to_float64(f, true, fpst);
-+    set_flush_inputs_to_zero(save, fpst);
-+    return ret;
-+}
-+
-+static inline float16 sve_f32_to_f16(float32 f, float_status *fpst)
-+{
-+    flag save = get_flush_to_zero(fpst);
-+    float16 ret;
-+
-+    set_flush_to_zero(false, fpst);
-+    ret = float32_to_float16(f, true, fpst);
-+    set_flush_to_zero(save, fpst);
-+    return ret;
-+}
-+
-+static inline float16 sve_f64_to_f16(float64 f, float_status *fpst)
-+{
-+    flag save = get_flush_to_zero(fpst);
-+    float16 ret;
-+
-+    set_flush_to_zero(false, fpst);
-+    ret = float64_to_float16(f, true, fpst);
-+    set_flush_to_zero(save, fpst);
-+    return ret;
-+}
-+
-+DO_ZPZ_FP(sve_fcvt_sh, uint32_t, H1_4, sve_f32_to_f16)
-+DO_ZPZ_FP(sve_fcvt_hs, uint32_t, H1_4, sve_f16_to_f32)
-+DO_ZPZ_FP(sve_fcvt_dh, uint64_t,     , sve_f64_to_f16)
-+DO_ZPZ_FP(sve_fcvt_hd, uint64_t,     , sve_f16_to_f64)
-+DO_ZPZ_FP(sve_fcvt_ds, uint64_t,     , float64_to_float32)
-+DO_ZPZ_FP(sve_fcvt_sd, uint64_t,     , float32_to_float64)
-+
- DO_ZPZ_FP(sve_scvt_hh, uint16_t, H1_2, int16_to_float16)
- DO_ZPZ_FP(sve_scvt_sh, uint32_t, H1_4, int32_to_float16)
- DO_ZPZ_FP(sve_scvt_ss, uint32_t, H1_4, int32_to_float32)
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
-+++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static bool do_zpz_ptr(DisasContext *s, int rd, int rn, int pg,
-     return true;
- }
-+static bool trans_FCVT_sh(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvt_sh);
-+}
-+
-+static bool trans_FCVT_hs(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvt_hs);
-+}
-+
-+static bool trans_FCVT_dh(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_fcvt_dh);
-+}
-+
-+static bool trans_FCVT_hd(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvt_hd);
-+}
-+
-+static bool trans_FCVT_ds(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvt_ds);
-+}
-+
-+static bool trans_FCVT_sd(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvt_sd);
-+}
-+
- static bool trans_SCVTF_hh(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
- {
-     return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_scvt_hh);
-diff --git a/target/arm/sve.decode b/target/arm/sve.decode
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
-+++ b/target/arm/sve.decode
-@@ -XXX,XX +XXX,XX @@ FNMLS_zpzzz     01100101 .. 1 ..... 111 ... ..... .....         @rdn_pg_rm_ra
- ### SVE FP Unary Operations Predicated Group
-+# SVE floating-point convert precision
-+FCVT_sh         01100101 10 0010 00 101 ... ..... .....         @rd_pg_rn_e0
-+FCVT_hs         01100101 10 0010 01 101 ... ..... .....         @rd_pg_rn_e0
-+FCVT_dh         01100101 11 0010 00 101 ... ..... .....         @rd_pg_rn_e0
-+FCVT_hd         01100101 11 0010 01 101 ... ..... .....         @rd_pg_rn_e0
-+FCVT_ds         01100101 11 0010 10 101 ... ..... .....         @rd_pg_rn_e0
-+FCVT_sd         01100101 11 0010 11 101 ... ..... .....         @rd_pg_rn_e0
-+
- # SVE integer convert to floating-point
- SCVTF_hh        01100101 01 010 01 0 101 ... ..... .....        @rd_pg_rn_e0
- SCVTF_sh        01100101 01 010 10 0 101 ... ..... .....        @rd_pg_rn_e0
---
-.17.1

-[Qemu-devel] [PULL 31/55] target/arm: Implement SVE floating-point round to integral value
+Deleted patch
-From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20180627043328.11531-26-richard.henderson@linaro.org
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
----
- target/arm/helper-sve.h    | 14 +++++++
- target/arm/sve_helper.c    |  8 ++++
- target/arm/translate-sve.c | 77 ++++++++++++++++++++++++++++++++++++++
- target/arm/sve.decode      |  9 +++++
-files changed, 108 insertions(+)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
-+++ b/target/arm/helper-sve.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_5(sve_fcvtzu_sd, TCG_CALL_NO_RWG,
- DEF_HELPER_FLAGS_5(sve_fcvtzu_dd, TCG_CALL_NO_RWG,
-                    void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_frint_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_frint_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_frint_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_5(sve_frintx_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_frintx_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_frintx_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+
- DEF_HELPER_FLAGS_5(sve_scvt_hh, TCG_CALL_NO_RWG,
-                    void, ptr, ptr, ptr, ptr, i32)
- DEF_HELPER_FLAGS_5(sve_scvt_sh, TCG_CALL_NO_RWG,
-diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve_helper.c
-+++ b/target/arm/sve_helper.c
-@@ -XXX,XX +XXX,XX @@ DO_ZPZ_FP(sve_fcvtzu_sd, uint64_t,     , vfp_float32_to_uint64_rtz)
- DO_ZPZ_FP(sve_fcvtzu_ds, uint64_t,     , helper_vfp_touizd)
- DO_ZPZ_FP(sve_fcvtzu_dd, uint64_t,     , vfp_float64_to_uint64_rtz)
-+DO_ZPZ_FP(sve_frint_h, uint16_t, H1_2, helper_advsimd_rinth)
-+DO_ZPZ_FP(sve_frint_s, uint32_t, H1_4, helper_rints)
-+DO_ZPZ_FP(sve_frint_d, uint64_t,     , helper_rintd)
-+
-+DO_ZPZ_FP(sve_frintx_h, uint16_t, H1_2, float16_round_to_int)
-+DO_ZPZ_FP(sve_frintx_s, uint32_t, H1_4, float32_round_to_int)
-+DO_ZPZ_FP(sve_frintx_d, uint64_t,     , float64_round_to_int)
-+
- DO_ZPZ_FP(sve_scvt_hh, uint16_t, H1_2, int16_to_float16)
- DO_ZPZ_FP(sve_scvt_sh, uint32_t, H1_4, int32_to_float16)
- DO_ZPZ_FP(sve_scvt_ss, uint32_t, H1_4, int32_to_float32)
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
-+++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static bool trans_FCVTZU_dd(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-     return do_zpz_ptr(s, a->rd, a->rn, a->pg, false, gen_helper_sve_fcvtzu_dd);
- }
-+static gen_helper_gvec_3_ptr * const frint_fns[3] = {
-+    gen_helper_sve_frint_h,
-+    gen_helper_sve_frint_s,
-+    gen_helper_sve_frint_d
-+};
-+
-+static bool trans_FRINTI(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    if (a->esz == 0) {
-+        return false;
-+    }
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, a->esz == MO_16,
-+                      frint_fns[a->esz - 1]);
-+}
-+
-+static bool trans_FRINTX(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    static gen_helper_gvec_3_ptr * const fns[3] = {
-+        gen_helper_sve_frintx_h,
-+        gen_helper_sve_frintx_s,
-+        gen_helper_sve_frintx_d
-+    };
-+    if (a->esz == 0) {
-+        return false;
-+    }
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, a->esz == MO_16, fns[a->esz - 1]);
-+}
-+
-+static bool do_frint_mode(DisasContext *s, arg_rpr_esz *a, int mode)
-+{
-+    if (a->esz == 0) {
-+        return false;
-+    }
-+    if (sve_access_check(s)) {
-+        unsigned vsz = vec_full_reg_size(s);
-+        TCGv_i32 tmode = tcg_const_i32(mode);
-+        TCGv_ptr status = get_fpstatus_ptr(a->esz == MO_16);
-+
-+        gen_helper_set_rmode(tmode, tmode, status);
-+
-+        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, a->rd),
-+                           vec_full_reg_offset(s, a->rn),
-+                           pred_full_reg_offset(s, a->pg),
-+                           status, vsz, vsz, 0, frint_fns[a->esz - 1]);
-+
-+        gen_helper_set_rmode(tmode, tmode, status);
-+        tcg_temp_free_i32(tmode);
-+        tcg_temp_free_ptr(status);
-+    }
-+    return true;
-+}
-+
-+static bool trans_FRINTN(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_frint_mode(s, a, float_round_nearest_even);
-+}
-+
-+static bool trans_FRINTP(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_frint_mode(s, a, float_round_up);
-+}
-+
-+static bool trans_FRINTM(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_frint_mode(s, a, float_round_down);
-+}
-+
-+static bool trans_FRINTZ(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_frint_mode(s, a, float_round_to_zero);
-+}
-+
-+static bool trans_FRINTA(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    return do_frint_mode(s, a, float_round_ties_away);
-+}
-+
- static bool trans_SCVTF_hh(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
- {
-     return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_scvt_hh);
-diff --git a/target/arm/sve.decode b/target/arm/sve.decode
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
-+++ b/target/arm/sve.decode
-@@ -XXX,XX +XXX,XX @@ FCVTZU_sd       01100101 11 011 10 1 101 ... ..... .....        @rd_pg_rn_e0
- FCVTZS_dd       01100101 11 011 11 0 101 ... ..... .....        @rd_pg_rn_e0
- FCVTZU_dd       01100101 11 011 11 1 101 ... ..... .....        @rd_pg_rn_e0
-+# SVE floating-point round to integral value
-+FRINTN          01100101 .. 000 000 101 ... ..... .....         @rd_pg_rn
-+FRINTP          01100101 .. 000 001 101 ... ..... .....         @rd_pg_rn
-+FRINTM          01100101 .. 000 010 101 ... ..... .....         @rd_pg_rn
-+FRINTZ          01100101 .. 000 011 101 ... ..... .....         @rd_pg_rn
-+FRINTA          01100101 .. 000 100 101 ... ..... .....         @rd_pg_rn
-+FRINTX          01100101 .. 000 110 101 ... ..... .....         @rd_pg_rn
-+FRINTI          01100101 .. 000 111 101 ... ..... .....         @rd_pg_rn
-+
- # SVE integer convert to floating-point
- SCVTF_hh        01100101 01 010 01 0 101 ... ..... .....        @rd_pg_rn_e0
- SCVTF_sh        01100101 01 010 10 0 101 ... ..... .....        @rd_pg_rn_e0
---
-.17.1

-[Qemu-devel] [PULL 32/55] target/arm: Implement SVE floating-point unary operations
+Deleted patch
-From: Richard Henderson <richard.henderson@linaro.org>
-Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
-Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
-Message-id: 20180627043328.11531-27-richard.henderson@linaro.org
-Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
----
- target/arm/helper-sve.h    | 14 ++++++++++++++
- target/arm/sve_helper.c    |  8 ++++++++
- target/arm/translate-sve.c | 26 ++++++++++++++++++++++++++
- target/arm/sve.decode      |  4 ++++
-files changed, 52 insertions(+)
-diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/helper-sve.h
-+++ b/target/arm/helper-sve.h
-@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_5(sve_frintx_s, TCG_CALL_NO_RWG,
- DEF_HELPER_FLAGS_5(sve_frintx_d, TCG_CALL_NO_RWG,
-                    void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_frecpx_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_frecpx_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_frecpx_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+
-+DEF_HELPER_FLAGS_5(sve_fsqrt_h, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_fsqrt_s, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+DEF_HELPER_FLAGS_5(sve_fsqrt_d, TCG_CALL_NO_RWG,
-+                   void, ptr, ptr, ptr, ptr, i32)
-+
- DEF_HELPER_FLAGS_5(sve_scvt_hh, TCG_CALL_NO_RWG,
-                    void, ptr, ptr, ptr, ptr, i32)
- DEF_HELPER_FLAGS_5(sve_scvt_sh, TCG_CALL_NO_RWG,
-diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve_helper.c
-+++ b/target/arm/sve_helper.c
-@@ -XXX,XX +XXX,XX @@ DO_ZPZ_FP(sve_frintx_h, uint16_t, H1_2, float16_round_to_int)
- DO_ZPZ_FP(sve_frintx_s, uint32_t, H1_4, float32_round_to_int)
- DO_ZPZ_FP(sve_frintx_d, uint64_t,     , float64_round_to_int)
-+DO_ZPZ_FP(sve_frecpx_h, uint16_t, H1_2, helper_frecpx_f16)
-+DO_ZPZ_FP(sve_frecpx_s, uint32_t, H1_4, helper_frecpx_f32)
-+DO_ZPZ_FP(sve_frecpx_d, uint64_t,     , helper_frecpx_f64)
-+
-+DO_ZPZ_FP(sve_fsqrt_h, uint16_t, H1_2, float16_sqrt)
-+DO_ZPZ_FP(sve_fsqrt_s, uint32_t, H1_4, float32_sqrt)
-+DO_ZPZ_FP(sve_fsqrt_d, uint64_t,     , float64_sqrt)
-+
- DO_ZPZ_FP(sve_scvt_hh, uint16_t, H1_2, int16_to_float16)
- DO_ZPZ_FP(sve_scvt_sh, uint32_t, H1_4, int32_to_float16)
- DO_ZPZ_FP(sve_scvt_ss, uint32_t, H1_4, int32_to_float32)
-diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/translate-sve.c
-+++ b/target/arm/translate-sve.c
-@@ -XXX,XX +XXX,XX @@ static bool trans_FRINTA(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-     return do_frint_mode(s, a, float_round_ties_away);
- }
-+static bool trans_FRECPX(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    static gen_helper_gvec_3_ptr * const fns[3] = {
-+        gen_helper_sve_frecpx_h,
-+        gen_helper_sve_frecpx_s,
-+        gen_helper_sve_frecpx_d
-+    };
-+    if (a->esz == 0) {
-+        return false;
-+    }
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, a->esz == MO_16, fns[a->esz - 1]);
-+}
-+
-+static bool trans_FSQRT(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
-+{
-+    static gen_helper_gvec_3_ptr * const fns[3] = {
-+        gen_helper_sve_fsqrt_h,
-+        gen_helper_sve_fsqrt_s,
-+        gen_helper_sve_fsqrt_d
-+    };
-+    if (a->esz == 0) {
-+        return false;
-+    }
-+    return do_zpz_ptr(s, a->rd, a->rn, a->pg, a->esz == MO_16, fns[a->esz - 1]);
-+}
-+
- static bool trans_SCVTF_hh(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
- {
-     return do_zpz_ptr(s, a->rd, a->rn, a->pg, true, gen_helper_sve_scvt_hh);
-diff --git a/target/arm/sve.decode b/target/arm/sve.decode
-index XXXXXXX..XXXXXXX 100644
---- a/target/arm/sve.decode
-+++ b/target/arm/sve.decode
-@@ -XXX,XX +XXX,XX @@ FRINTA          01100101 .. 000 100 101 ... ..... .....         @rd_pg_rn
- FRINTX          01100101 .. 000 110 101 ... ..... .....         @rd_pg_rn
- FRINTI          01100101 .. 000 111 101 ... ..... .....         @rd_pg_rn
-+# SVE floating-point unary operations
-+FRECPX          01100101 .. 001 100 101 ... ..... .....         @rd_pg_rn
-+FSQRT           01100101 .. 001 101 101 ... ..... .....         @rd_pg_rn
-+
- # SVE integer convert to floating-point
- SCVTF_hh        01100101 01 010 01 0 101 ... ..... .....        @rd_pg_rn_e0
- SCVTF_sh        01100101 01 010 10 0 101 ... ..... .....        @rd_pg_rn_e0
---
-.17.1

Hopefully last target-arm queue before softfreeze;
this one's largest part is the remainder of the SVE patches,
but there are a selection of other minor things too.

thanks
-- PMM

The following changes since commit 109b25045b3651f9c5d02c3766c0b3ff63e6d193:

Merge remote-tracking branch 'remotes/bonzini/tags/for-upstream' into staging (2018-06-29 12:30:29 +0100)

are available in the Git repository at:

git://git.linaro.org/people/pmaydell/qemu-arm.git tags/pull-target-arm-20180629

for you to fetch changes up to 802abf4024d23e48d45373ac3f2b580124b54b47:

target/arm: Add ID_ISAR6 (2018-06-29 15:30:54 +0100)

----------------------------------------------------------------
target-arm queue:
 * last of the SVE patches; SVE is now enabled for aarch64 linux-user
 * sd: Don't trace SDRequest crc field (coverity bugfix)
 * target/arm: Mark PMINTENSET accesses as possibly doing IO
 * clean up v7VE feature bit handling
 * i.mx7d: minor cleanups
 * target/arm: support reading of CNT[VCT|FRQ]_EL0 from user-space
 * target/arm: Implement ARMv8.2-DotProd
 * virt: add addresses to dt node names (which stops dtc from
   complaining that they're not correctly named)
 * cleanups: replace error_setg(&error_fatal) by error_report() + exit()

----------------------------------------------------------------
Aaron Lindsay (3):
      target/arm: Add ARM_FEATURE_V7VE for v7 Virtualization Extensions
      target/arm: Remove redundant DIV detection for KVM
      target/arm: Mark PMINTENSET accesses as possibly doing IO

Alex Bennée (1):
      target/arm: support reading of CNT[VCT|FRQ]_EL0 from user-space

Eric Auger (3):
      device_tree: Add qemu_fdt_node_unit_path
      hw/arm/virt: Silence dtc /intc warnings
      hw/arm/virt: Silence dtc /memory warning

Jean-Christophe Dubois (3):
      i.mx7d: Remove unused header files
      i.mx7d: Change SRC unimplemented device name from sdma to src
      i.mx7d: Change IRQ number type from hwaddr to int

Peter Maydell (1):
      sd: Don't trace SDRequest crc field

Philippe Mathieu-Daudé (4):
      hw/block/fdc: Replace error_setg(&error_abort) by assert()
      hw/arm/sysbus-fdt: Replace error_setg(&error_fatal) by error_report() + exit()
      device_tree: Replace error_setg(&error_fatal) by error_report() + exit()
      sdcard: Use the ldst API

Richard Henderson (40):
      target/arm: Implement SVE Memory Contiguous Load Group
      target/arm: Implement SVE Contiguous Load, first-fault and no-fault
      target/arm: Implement SVE Memory Contiguous Store Group
      target/arm: Implement SVE load and broadcast quadword
      target/arm: Implement SVE integer convert to floating-point
      target/arm: Implement SVE floating-point arithmetic (predicated)
      target/arm: Implement SVE FP Multiply-Add Group
      target/arm: Implement SVE Floating Point Accumulating Reduction Group
      target/arm: Implement SVE load and broadcast element
      target/arm: Implement SVE store vector/predicate register
      target/arm: Implement SVE scatter stores
      target/arm: Implement SVE prefetches
      target/arm: Implement SVE gather loads
      target/arm: Implement SVE first-fault gather loads
      target/arm: Implement SVE scatter store vector immediate
      target/arm: Implement SVE floating-point compare vectors
      target/arm: Implement SVE floating-point arithmetic with immediate
      target/arm: Implement SVE Floating Point Multiply Indexed Group
      target/arm: Implement SVE FP Fast Reduction Group
      target/arm: Implement SVE Floating Point Unary Operations - Unpredicated Group
      target/arm: Implement SVE FP Compare with Zero Group
      target/arm: Implement SVE floating-point trig multiply-add coefficient
      target/arm: Implement SVE floating-point convert precision
      target/arm: Implement SVE floating-point convert to integer
      target/arm: Implement SVE floating-point round to integral value
      target/arm: Implement SVE floating-point unary operations
      target/arm: Implement SVE MOVPRFX
      target/arm: Implement SVE floating-point complex add
      target/arm: Implement SVE fp complex multiply add
      target/arm: Pass index to AdvSIMD FCMLA (indexed)
      target/arm: Implement SVE fp complex multiply add (indexed)
      target/arm: Implement SVE dot product (vectors)
      target/arm: Implement SVE dot product (indexed)
      target/arm: Enable SVE for aarch64-linux-user
      target/arm: Implement ARMv8.2-DotProd
      target/arm: Fix SVE signed division vs x86 overflow exception
      target/arm: Fix SVE system register access checks
      target/arm: Prune a57 features from max
      target/arm: Prune a15 features from max
      target/arm: Add ID_ISAR6

From: Philippe Mathieu-Daudé <f4bug@amsat.org>

Use assert() instead of error_setg(&error_abort),
as suggested by the "qapi/error.h" documentation:

Please don't error_setg(&error_fatal, ...), use error_report() and
    exit(), because that's more obvious.
    Likewise, don't error_setg(&error_abort, ...), use assert().

Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Acked-by: John Snow <jsnow@redhat.com>
Message-id: 20180625165749.3910-2-f4bug@amsat.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/block/fdc.c | 9 +--------
 1 file changed, 1 insertion(+), 8 deletions(-)

diff --git a/hw/block/fdc.c b/hw/block/fdc.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/block/fdc.c
+++ b/hw/block/fdc.c
@@ -XXX,XX +XXX,XX @@ static int pick_geometry(FDrive *drv)
                            nb_sectors,
                            FloppyDriveType_str(parse->drive));
         }
+        assert(type_match != -1 && "misconfigured fd_format");
         match = type_match;
     }
-
-    /* No match of any kind found -- fd_format is misconfigured, abort. */
-    if (match == -1) {
-        error_setg(&error_abort, "No candidate geometries present in table "
-                   " for floppy drive type '%s'",
-                   FloppyDriveType_str(drv->drive));
-    }
-
     parse = &(fd_formats[match]);
 
  out:
-- 
2.17.1

From: Philippe Mathieu-Daudé <f4bug@amsat.org>

Use error_report() + exit() instead of error_setg(&error_fatal),
as suggested by the "qapi/error.h" documentation:

Please don't error_setg(&error_fatal, ...), use error_report() and
   exit(), because that's more obvious.

This fixes CID 1352173:
    "Passing null pointer dt_name to qemu_fdt_node_path, which dereferences it."

And this also fixes:

hw/arm/sysbus-fdt.c:322:9: warning: Array access (from variable 'node_path') results in a null pointer dereference
        if (node_path[1]) {
            ^~~~~~~~~~~~

Fixes: Coverity CID 1352173 (Dereference after null check)
Suggested-by: Eric Blake <eblake@redhat.com>
Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Reviewed-by: Eric Auger <eric.auger@redhat.com>
Message-id: 20180625165749.3910-3-f4bug@amsat.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/arm/sysbus-fdt.c | 53 +++++++++++++++++++++++++--------------------
 1 file changed, 30 insertions(+), 23 deletions(-)

diff --git a/hw/arm/sysbus-fdt.c b/hw/arm/sysbus-fdt.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/sysbus-fdt.c
+++ b/hw/arm/sysbus-fdt.c
@@ -XXX,XX +XXX,XX @@ static void copy_properties_from_host(HostProperty *props, int nb_props,
         r = qemu_fdt_getprop(host_fdt, node_path,
                              props[i].name,
                              &prop_len,
-                             props[i].optional ? &err : &error_fatal);
+                             &err);
         if (r) {
             qemu_fdt_setprop(guest_fdt, nodename,
                              props[i].name, r, prop_len);
         } else {
-            if (prop_len != -FDT_ERR_NOTFOUND) {
-                /* optional property not returned although property exists */
-                error_report_err(err);
-            } else {
+            if (props[i].optional && prop_len == -FDT_ERR_NOTFOUND) {
+                /* optional property does not exist */
                 error_free(err);
+            } else {
+                error_report_err(err);
+            }
+            if (!props[i].optional) {
+                /* mandatory property not found: bail out */
+                exit(1);
             }
         }
     }
@@ -XXX,XX +XXX,XX @@ static void fdt_build_clock_node(void *host_fdt, void *guest_fdt,
 
     node_offset = fdt_node_offset_by_phandle(host_fdt, host_phandle);
     if (node_offset <= 0) {
-        error_setg(&error_fatal,
-                   "not able to locate clock handle %d in host device tree",
-                   host_phandle);
+        error_report("not able to locate clock handle %d in host device tree",
+                     host_phandle);
+        exit(1);
     }
     node_path = g_malloc(path_len);
     while ((ret = fdt_get_path(host_fdt, node_offset, node_path, path_len))
@@ -XXX,XX +XXX,XX @@ static void fdt_build_clock_node(void *host_fdt, void *guest_fdt,
         node_path = g_realloc(node_path, path_len);
     }
     if (ret < 0) {
-        error_setg(&error_fatal,
-                   "not able to retrieve node path for clock handle %d",
-                   host_phandle);
+        error_report("not able to retrieve node path for clock handle %d",
+                     host_phandle);
+        exit(1);
     }
 
     r = qemu_fdt_getprop(host_fdt, node_path, "compatible", &prop_len,
                          &error_fatal);
     if (strcmp(r, "fixed-clock")) {
-        error_setg(&error_fatal,
-                   "clock handle %d is not a fixed clock", host_phandle);
+        error_report("clock handle %d is not a fixed clock", host_phandle);
+        exit(1);
     }
 
     nodename = strrchr(node_path, '/');
@@ -XXX,XX +XXX,XX @@ static int add_amd_xgbe_fdt_node(SysBusDevice *sbdev, void *opaque)
 
     dt_name = sysfs_to_dt_name(vbasedev->name);
     if (!dt_name) {
-        error_setg(&error_fatal, "%s incorrect sysfs device name %s",
-                    __func__, vbasedev->name);
+        error_report("%s incorrect sysfs device name %s",
+                     __func__, vbasedev->name);
+        exit(1);
     }
     node_path = qemu_fdt_node_path(host_fdt, dt_name, vdev->compat,
                                    &error_fatal);
     if (!node_path || !node_path[0]) {
-        error_setg(&error_fatal, "%s unable to retrieve node path for %s/%s",
-                   __func__, dt_name, vdev->compat);
+        error_report("%s unable to retrieve node path for %s/%s",
+                     __func__, dt_name, vdev->compat);
+        exit(1);
     }
 
     if (node_path[1]) {
-        error_setg(&error_fatal, "%s more than one node matching %s/%s!",
-                   __func__, dt_name, vdev->compat);
+        error_report("%s more than one node matching %s/%s!",
+                     __func__, dt_name, vdev->compat);
+        exit(1);
     }
 
     g_free(dt_name);
 
     if (vbasedev->num_regions != 5) {
-        error_setg(&error_fatal, "%s Does the host dt node combine XGBE/PHY?",
-                   __func__);
+        error_report("%s Does the host dt node combine XGBE/PHY?", __func__);
+        exit(1);
     }
 
     /* generate nodes for DMA_CLK and PTP_CLK */
     r = qemu_fdt_getprop(host_fdt, node_path[0], "clocks",
                          &prop_len, &error_fatal);
     if (prop_len != 8) {
-        error_setg(&error_fatal, "%s clocks property should contain 2 handles",
-                   __func__);
+        error_report("%s clocks property should contain 2 handles", __func__);
+        exit(1);
     }
     host_clock_phandles = (uint32_t *)r;
     guest_clock_phandles[0] = qemu_fdt_alloc_phandle(guest_fdt);
-- 
2.17.1

From: Philippe Mathieu-Daudé <f4bug@amsat.org>

Use error_report() + exit() instead of error_setg(&error_fatal),
as suggested by the "qapi/error.h" documentation:

Please don't error_setg(&error_fatal, ...), use error_report() and
   exit(), because that's more obvious.

Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Reviewed-by: Eric Auger <eric.auger@redhat.com>
Reviewed-by: Markus Armbruster <armbru@redhat.com>
Reviewed-by: David Gibson <david@gibson.dropbear.id.au>
Message-id: 20180625165749.3910-4-f4bug@amsat.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 device_tree.c | 23 +++++++++++++----------
 1 file changed, 13 insertions(+), 10 deletions(-)

diff --git a/device_tree.c b/device_tree.c
index XXXXXXX..XXXXXXX 100644
--- a/device_tree.c
+++ b/device_tree.c
@@ -XXX,XX +XXX,XX @@ static void read_fstree(void *fdt, const char *dirname)
     const char *parent_node;
 
     if (strstr(dirname, root_dir) != dirname) {
-        error_setg(&error_fatal, "%s: %s must be searched within %s",
-                   __func__, dirname, root_dir);
+        error_report("%s: %s must be searched within %s",
+                     __func__, dirname, root_dir);
+        exit(1);
     }
     parent_node = &dirname[strlen(SYSFS_DT_BASEDIR)];
 
     d = opendir(dirname);
     if (!d) {
-        error_setg(&error_fatal, "%s cannot open %s", __func__, dirname);
-        return;
+        error_report("%s cannot open %s", __func__, dirname);
+        exit(1);
     }
 
     while ((de = readdir(d)) != NULL) {
@@ -XXX,XX +XXX,XX @@ static void read_fstree(void *fdt, const char *dirname)
         tmpnam = g_strdup_printf("%s/%s", dirname, de->d_name);
 
         if (lstat(tmpnam, &st) < 0) {
-            error_setg(&error_fatal, "%s cannot lstat %s", __func__, tmpnam);
+            error_report("%s cannot lstat %s", __func__, tmpnam);
+            exit(1);
         }
 
         if (S_ISREG(st.st_mode)) {
@@ -XXX,XX +XXX,XX @@ static void read_fstree(void *fdt, const char *dirname)
             gsize len;
 
             if (!g_file_get_contents(tmpnam, &val, &len, NULL)) {
-                error_setg(&error_fatal, "%s not able to extract info from %s",
-                           __func__, tmpnam);
+                error_report("%s not able to extract info from %s",
+                             __func__, tmpnam);
+                exit(1);
             }
 
             if (strlen(parent_node) > 0) {
@@ -XXX,XX +XXX,XX @@ void *load_device_tree_from_sysfs(void)
     host_fdt = create_device_tree(&host_fdt_size);
     read_fstree(host_fdt, SYSFS_DT_BASEDIR);
     if (fdt_check_header(host_fdt)) {
-        error_setg(&error_fatal,
-                   "%s host device tree extracted into memory is invalid",
-                   __func__);
+        error_report("%s host device tree extracted into memory is invalid",
+                     __func__);
+        exit(1);
     }
     return host_fdt;
 }
-- 
2.17.1

From: Eric Auger <eric.auger@redhat.com>

This helper allows to retrieve the paths of nodes whose name
match node-name or node-name@unit-address patterns.

Signed-off-by: Eric Auger <eric.auger@redhat.com>
Message-id: 1530044492-24921-2-git-send-email-eric.auger@redhat.com
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/sysemu/device_tree.h | 16 +++++++++++
 device_tree.c                | 55 ++++++++++++++++++++++++++++++++++++
 2 files changed, 71 insertions(+)

diff --git a/include/sysemu/device_tree.h b/include/sysemu/device_tree.h
index XXXXXXX..XXXXXXX 100644
--- a/include/sysemu/device_tree.h
+++ b/include/sysemu/device_tree.h
@@ -XXX,XX +XXX,XX @@ void *load_device_tree_from_sysfs(void);
 char **qemu_fdt_node_path(void *fdt, const char *name, char *compat,
                           Error **errp);
 
+/**
+ * qemu_fdt_node_unit_path: return the paths of nodes matching a given
+ * node-name, ie. node-name and node-name@unit-address
+ * @fdt: pointer to the dt blob
+ * @name: node name
+ * @errp: handle to an error object
+ *
+ * returns a newly allocated NULL-terminated array of node paths.
+ * Use g_strfreev() to free it. If one or more nodes were found, the
+ * array contains the path of each node and the last element equals to
+ * NULL. If there is no error but no matching node was found, the
+ * returned array contains a single element equal to NULL. If an error
+ * was encountered when parsing the blob, the function returns NULL
+ */
+char **qemu_fdt_node_unit_path(void *fdt, const char *name, Error **errp);
+
 int qemu_fdt_setprop(void *fdt, const char *node_path,
                      const char *property, const void *val, int size);
 int qemu_fdt_setprop_cell(void *fdt, const char *node_path,
diff --git a/device_tree.c b/device_tree.c
index XXXXXXX..XXXXXXX 100644
--- a/device_tree.c
+++ b/device_tree.c
@@ -XXX,XX +XXX,XX @@ static int findnode_nofail(void *fdt, const char *node_path)
     return offset;
 }
 
+char **qemu_fdt_node_unit_path(void *fdt, const char *name, Error **errp)
+{
+    char *prefix =  g_strdup_printf("%s@", name);
+    unsigned int path_len = 16, n = 0;
+    GSList *path_list = NULL, *iter;
+    const char *iter_name;
+    int offset, len, ret;
+    char **path_array;
+
+    offset = fdt_next_node(fdt, -1, NULL);
+
+    while (offset >= 0) {
+        iter_name = fdt_get_name(fdt, offset, &len);
+        if (!iter_name) {
+            offset = len;
+            break;
+        }
+        if (!strcmp(iter_name, name) || g_str_has_prefix(iter_name, prefix)) {
+            char *path;
+
+            path = g_malloc(path_len);
+            while ((ret = fdt_get_path(fdt, offset, path, path_len))
+                  == -FDT_ERR_NOSPACE) {
+                path_len += 16;
+                path = g_realloc(path, path_len);
+            }
+            path_list = g_slist_prepend(path_list, path);
+            n++;
+        }
+        offset = fdt_next_node(fdt, offset, NULL);
+    }
+    g_free(prefix);
+
+    if (offset < 0 && offset != -FDT_ERR_NOTFOUND) {
+        error_setg(errp, "%s: abort parsing dt for %s node units: %s",
+                   __func__, name, fdt_strerror(offset));
+        for (iter = path_list; iter; iter = iter->next) {
+            g_free(iter->data);
+        }
+        g_slist_free(path_list);
+        return NULL;
+    }
+
+    path_array = g_new(char *, n + 1);
+    path_array[n--] = NULL;
+
+    for (iter = path_list; iter; iter = iter->next) {
+        path_array[n--] = iter->data;
+    }
+
+    g_slist_free(path_list);
+
+    return path_array;
+}
+
 char **qemu_fdt_node_path(void *fdt, const char *name, char *compat,
                           Error **errp)
 {
-- 
2.17.1

From: Eric Auger <eric.auger@redhat.com>

When running dtc on the guest /proc/device-tree we get the
following warnings: "Warning (unit_address_vs_reg): Node <name>
has a reg or ranges property, but no unit name", with name:
/intc, /intc/its, /intc/v2m.

Nodes should have a name in the form <name>[@<unit-address>] where
unit-address is the primary address used to access the device, listed
in the node's reg property. This fix seems to make dtc happy.

Signed-off-by: Eric Auger <eric.auger@redhat.com>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 1530044492-24921-3-git-send-email-eric.auger@redhat.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/arm/virt.c | 63 +++++++++++++++++++++++++++++++--------------------
 1 file changed, 39 insertions(+), 24 deletions(-)

diff --git a/hw/arm/virt.c b/hw/arm/virt.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/virt.c
+++ b/hw/arm/virt.c
@@ -XXX,XX +XXX,XX @@ static void fdt_add_cpu_nodes(const VirtMachineState *vms)
 
 static void fdt_add_its_gic_node(VirtMachineState *vms)
 {
+    char *nodename;
+
     vms->msi_phandle = qemu_fdt_alloc_phandle(vms->fdt);
-    qemu_fdt_add_subnode(vms->fdt, "/intc/its");
-    qemu_fdt_setprop_string(vms->fdt, "/intc/its", "compatible",
+    nodename = g_strdup_printf("/intc/its@%" PRIx64,
+                               vms->memmap[VIRT_GIC_ITS].base);
+    qemu_fdt_add_subnode(vms->fdt, nodename);
+    qemu_fdt_setprop_string(vms->fdt, nodename, "compatible",
                             "arm,gic-v3-its");
-    qemu_fdt_setprop(vms->fdt, "/intc/its", "msi-controller", NULL, 0);
-    qemu_fdt_setprop_sized_cells(vms->fdt, "/intc/its", "reg",
+    qemu_fdt_setprop(vms->fdt, nodename, "msi-controller", NULL, 0);
+    qemu_fdt_setprop_sized_cells(vms->fdt, nodename, "reg",
                                  2, vms->memmap[VIRT_GIC_ITS].base,
                                  2, vms->memmap[VIRT_GIC_ITS].size);
-    qemu_fdt_setprop_cell(vms->fdt, "/intc/its", "phandle", vms->msi_phandle);
+    qemu_fdt_setprop_cell(vms->fdt, nodename, "phandle", vms->msi_phandle);
+    g_free(nodename);
 }
 
 static void fdt_add_v2m_gic_node(VirtMachineState *vms)
 {
+    char *nodename;
+
+    nodename = g_strdup_printf("/intc/v2m@%" PRIx64,
+                               vms->memmap[VIRT_GIC_V2M].base);
     vms->msi_phandle = qemu_fdt_alloc_phandle(vms->fdt);
-    qemu_fdt_add_subnode(vms->fdt, "/intc/v2m");
-    qemu_fdt_setprop_string(vms->fdt, "/intc/v2m", "compatible",
+    qemu_fdt_add_subnode(vms->fdt, nodename);
+    qemu_fdt_setprop_string(vms->fdt, nodename, "compatible",
                             "arm,gic-v2m-frame");
-    qemu_fdt_setprop(vms->fdt, "/intc/v2m", "msi-controller", NULL, 0);
-    qemu_fdt_setprop_sized_cells(vms->fdt, "/intc/v2m", "reg",
+    qemu_fdt_setprop(vms->fdt, nodename, "msi-controller", NULL, 0);
+    qemu_fdt_setprop_sized_cells(vms->fdt, nodename, "reg",
                                  2, vms->memmap[VIRT_GIC_V2M].base,
                                  2, vms->memmap[VIRT_GIC_V2M].size);
-    qemu_fdt_setprop_cell(vms->fdt, "/intc/v2m", "phandle", vms->msi_phandle);
+    qemu_fdt_setprop_cell(vms->fdt, nodename, "phandle", vms->msi_phandle);
+    g_free(nodename);
 }
 
 static void fdt_add_gic_node(VirtMachineState *vms)
 {
+    char *nodename;
+
     vms->gic_phandle = qemu_fdt_alloc_phandle(vms->fdt);
     qemu_fdt_setprop_cell(vms->fdt, "/", "interrupt-parent", vms->gic_phandle);
 
-    qemu_fdt_add_subnode(vms->fdt, "/intc");
-    qemu_fdt_setprop_cell(vms->fdt, "/intc", "#interrupt-cells", 3);
-    qemu_fdt_setprop(vms->fdt, "/intc", "interrupt-controller", NULL, 0);
-    qemu_fdt_setprop_cell(vms->fdt, "/intc", "#address-cells", 0x2);
-    qemu_fdt_setprop_cell(vms->fdt, "/intc", "#size-cells", 0x2);
-    qemu_fdt_setprop(vms->fdt, "/intc", "ranges", NULL, 0);
+    nodename = g_strdup_printf("/intc@%" PRIx64,
+                               vms->memmap[VIRT_GIC_DIST].base);
+    qemu_fdt_add_subnode(vms->fdt, nodename);
+    qemu_fdt_setprop_cell(vms->fdt, nodename, "#interrupt-cells", 3);
+    qemu_fdt_setprop(vms->fdt, nodename, "interrupt-controller", NULL, 0);
+    qemu_fdt_setprop_cell(vms->fdt, nodename, "#address-cells", 0x2);
+    qemu_fdt_setprop_cell(vms->fdt, nodename, "#size-cells", 0x2);
+    qemu_fdt_setprop(vms->fdt, nodename, "ranges", NULL, 0);
     if (vms->gic_version == 3) {
         int nb_redist_regions = virt_gicv3_redist_region_count(vms);
 
-        qemu_fdt_setprop_string(vms->fdt, "/intc", "compatible",
+        qemu_fdt_setprop_string(vms->fdt, nodename, "compatible",
                                 "arm,gic-v3");
 
-        qemu_fdt_setprop_cell(vms->fdt, "/intc",
+        qemu_fdt_setprop_cell(vms->fdt, nodename,
                               "#redistributor-regions", nb_redist_regions);
 
         if (nb_redist_regions == 1) {
-            qemu_fdt_setprop_sized_cells(vms->fdt, "/intc", "reg",
+            qemu_fdt_setprop_sized_cells(vms->fdt, nodename, "reg",
                                          2, vms->memmap[VIRT_GIC_DIST].base,
                                          2, vms->memmap[VIRT_GIC_DIST].size,
                                          2, vms->memmap[VIRT_GIC_REDIST].base,
                                          2, vms->memmap[VIRT_GIC_REDIST].size);
         } else {
-            qemu_fdt_setprop_sized_cells(vms->fdt, "/intc", "reg",
+            qemu_fdt_setprop_sized_cells(vms->fdt, nodename, "reg",
                                          2, vms->memmap[VIRT_GIC_DIST].base,
                                          2, vms->memmap[VIRT_GIC_DIST].size,
                                          2, vms->memmap[VIRT_GIC_REDIST].base,
@@ -XXX,XX +XXX,XX @@ static void fdt_add_gic_node(VirtMachineState *vms)
         }
 
         if (vms->virt) {
-            qemu_fdt_setprop_cells(vms->fdt, "/intc", "interrupts",
+            qemu_fdt_setprop_cells(vms->fdt, nodename, "interrupts",
                                    GIC_FDT_IRQ_TYPE_PPI, ARCH_GICV3_MAINT_IRQ,
                                    GIC_FDT_IRQ_FLAGS_LEVEL_HI);
         }
     } else {
         /* 'cortex-a15-gic' means 'GIC v2' */
-        qemu_fdt_setprop_string(vms->fdt, "/intc", "compatible",
+        qemu_fdt_setprop_string(vms->fdt, nodename, "compatible",
                                 "arm,cortex-a15-gic");
-        qemu_fdt_setprop_sized_cells(vms->fdt, "/intc", "reg",
+        qemu_fdt_setprop_sized_cells(vms->fdt, nodename, "reg",
                                       2, vms->memmap[VIRT_GIC_DIST].base,
                                       2, vms->memmap[VIRT_GIC_DIST].size,
                                       2, vms->memmap[VIRT_GIC_CPU].base,
                                       2, vms->memmap[VIRT_GIC_CPU].size);
     }
 
-    qemu_fdt_setprop_cell(vms->fdt, "/intc", "phandle", vms->gic_phandle);
+    qemu_fdt_setprop_cell(vms->fdt, nodename, "phandle", vms->gic_phandle);
+    g_free(nodename);
 }
 
 static void fdt_add_pmu_nodes(const VirtMachineState *vms)
-- 
2.17.1

From: Eric Auger <eric.auger@redhat.com>

When running dtc on the guest /proc/device-tree we get the
following warning: Warning (unit_address_vs_reg): Node /memory
has a reg or ranges property, but no unit name".

Let's fix that by adding the unit address to the node name. We also
don't create the /memory node anymore in create_fdt(). We directly
create it in load_dtb. /chosen still needs to be created in create_fdt
as the uart needs it. In case the user provided his own dtb, we nop
all memory nodes found in root and create new one(s).

Signed-off-by: Eric Auger <eric.auger@redhat.com>
Message-id: 1530044492-24921-4-git-send-email-eric.auger@redhat.com
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/arm/boot.c | 41 +++++++++++++++++++++++------------------
 hw/arm/virt.c |  7 +------
 2 files changed, 24 insertions(+), 24 deletions(-)

diff --git a/hw/arm/boot.c b/hw/arm/boot.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/boot.c
+++ b/hw/arm/boot.c
@@ -XXX,XX +XXX,XX @@ int arm_load_dtb(hwaddr addr, const struct arm_boot_info *binfo,
                  hwaddr addr_limit, AddressSpace *as)
 {
     void *fdt = NULL;
-    int size, rc;
+    int size, rc, n = 0;
     uint32_t acells, scells;
     char *nodename;
     unsigned int i;
     hwaddr mem_base, mem_len;
+    char **node_path;
+    Error *err = NULL;
 
     if (binfo->dtb_filename) {
         char *filename;
@@ -XXX,XX +XXX,XX @@ int arm_load_dtb(hwaddr addr, const struct arm_boot_info *binfo,
         goto fail;
     }
 
+    /* nop all root nodes matching /memory or /memory@unit-address */
+    node_path = qemu_fdt_node_unit_path(fdt, "memory", &err);
+    if (err) {
+        error_report_err(err);
+        goto fail;
+    }
+    while (node_path[n]) {
+        if (g_str_has_prefix(node_path[n], "/memory")) {
+            qemu_fdt_nop_node(fdt, node_path[n]);
+        }
+        n++;
+    }
+    g_strfreev(node_path);
+
     if (nb_numa_nodes > 0) {
-        /*
-         * Turn the /memory node created before into a NOP node, then create
-         * /memory@addr nodes for all numa nodes respectively.
-         */
-        qemu_fdt_nop_node(fdt, "/memory");
         mem_base = binfo->loader_start;
         for (i = 0; i < nb_numa_nodes; i++) {
             mem_len = numa_info[i].node_mem;
@@ -XXX,XX +XXX,XX @@ int arm_load_dtb(hwaddr addr, const struct arm_boot_info *binfo,
             g_free(nodename);
         }
     } else {
-        Error *err = NULL;
+        nodename = g_strdup_printf("/memory@%" PRIx64, binfo->loader_start);
+        qemu_fdt_add_subnode(fdt, nodename);
+        qemu_fdt_setprop_string(fdt, nodename, "device_type", "memory");
 
-        rc = fdt_path_offset(fdt, "/memory");
-        if (rc < 0) {
-            qemu_fdt_add_subnode(fdt, "/memory");
-        }
-
-        if (!qemu_fdt_getprop(fdt, "/memory", "device_type", NULL, &err)) {
-            qemu_fdt_setprop_string(fdt, "/memory", "device_type", "memory");
-        }
-
-        rc = qemu_fdt_setprop_sized_cells(fdt, "/memory", "reg",
+        rc = qemu_fdt_setprop_sized_cells(fdt, nodename, "reg",
                                           acells, binfo->loader_start,
                                           scells, binfo->ram_size);
         if (rc < 0) {
-            fprintf(stderr, "couldn't set /memory/reg\n");
+            fprintf(stderr, "couldn't set %s reg\n", nodename);
             goto fail;
         }
+        g_free(nodename);
     }
 
     rc = fdt_path_offset(fdt, "/chosen");
diff --git a/hw/arm/virt.c b/hw/arm/virt.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/virt.c
+++ b/hw/arm/virt.c
@@ -XXX,XX +XXX,XX @@ static void create_fdt(VirtMachineState *vms)
     qemu_fdt_setprop_cell(fdt, "/", "#address-cells", 0x2);
     qemu_fdt_setprop_cell(fdt, "/", "#size-cells", 0x2);
 
-    /*
-     * /chosen and /memory nodes must exist for load_dtb
-     * to fill in necessary properties later
-     */
+    /* /chosen must exist for load_dtb to fill in necessary properties later */
     qemu_fdt_add_subnode(fdt, "/chosen");
-    qemu_fdt_add_subnode(fdt, "/memory");
-    qemu_fdt_setprop_string(fdt, "/memory", "device_type", "memory");
 
     /* Clock node, for the benefit of the UART. The kernel device tree
      * binding documentation claims the PL011 node clock properties are
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Alex Bennée <alex.bennee@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-2-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    |  35 +++++++++
 target/arm/sve_helper.c    | 153 +++++++++++++++++++++++++++++++++++++
 target/arm/translate-sve.c | 121 +++++++++++++++++++++++++++++
 target/arm/sve.decode      |  34 +++++++++
 4 files changed, 343 insertions(+)

diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper-sve.h
+++ b/target/arm/helper-sve.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_5(gvec_rsqrts_s, TCG_CALL_NO_RWG,
                    void, ptr, ptr, ptr, ptr, i32)
 DEF_HELPER_FLAGS_5(gvec_rsqrts_d, TCG_CALL_NO_RWG,
                    void, ptr, ptr, ptr, ptr, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld2bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld3bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld4bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld2hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld3hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld4hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld2ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld3ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld4ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld2dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld3dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld4dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1bhu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1bsu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1bdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1bhs_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1bss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1bds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1hsu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1hdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1hss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1hds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ld1sdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ld1sds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve_helper.c
+++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ uint32_t HELPER(sve_while)(void *vd, uint32_t count, uint32_t pred_desc)
 
     return predtest_ones(d, oprsz, esz_mask);
 }
+
+/*
+ * Load contiguous data, protected by a governing predicate.
+ */
+#define DO_LD1(NAME, FN, TYPEE, TYPEM, H)                  \
+static void do_##NAME(CPUARMState *env, void *vd, void *vg, \
+                      target_ulong addr, intptr_t oprsz,   \
+                      uintptr_t ra)                        \
+{                                                          \
+    intptr_t i = 0;                                        \
+    do {                                                   \
+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));    \
+        do {                                               \
+            TYPEM m = 0;                                   \
+            if (pg & 1) {                                  \
+                m = FN(env, addr, ra);                     \
+            }                                              \
+            *(TYPEE *)(vd + H(i)) = m;                     \
+            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);      \
+            addr += sizeof(TYPEM);                         \
+        } while (i & 15);                                  \
+    } while (i < oprsz);                                   \
+}                                                          \
+void HELPER(NAME)(CPUARMState *env, void *vg,              \
+                  target_ulong addr, uint32_t desc)        \
+{                                                          \
+    do_##NAME(env, &env->vfp.zregs[simd_data(desc)], vg,   \
+              addr, simd_oprsz(desc), GETPC());            \
+}
+
+#define DO_LD2(NAME, FN, TYPEE, TYPEM, H)                  \
+void HELPER(NAME)(CPUARMState *env, void *vg,              \
+                  target_ulong addr, uint32_t desc)        \
+{                                                          \
+    intptr_t i, oprsz = simd_oprsz(desc);                  \
+    intptr_t ra = GETPC();                                 \
+    unsigned rd = simd_data(desc);                         \
+    void *d1 = &env->vfp.zregs[rd];                        \
+    void *d2 = &env->vfp.zregs[(rd + 1) & 31];             \
+    for (i = 0; i < oprsz; ) {                             \
+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));    \
+        do {                                               \
+            TYPEM m1 = 0, m2 = 0;                          \
+            if (pg & 1) {                                  \
+                m1 = FN(env, addr, ra);                    \
+                m2 = FN(env, addr + sizeof(TYPEM), ra);    \
+            }                                              \
+            *(TYPEE *)(d1 + H(i)) = m1;                    \
+            *(TYPEE *)(d2 + H(i)) = m2;                    \
+            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);      \
+            addr += 2 * sizeof(TYPEM);                     \
+        } while (i & 15);                                  \
+    }                                                      \
+}
+
+#define DO_LD3(NAME, FN, TYPEE, TYPEM, H)                  \
+void HELPER(NAME)(CPUARMState *env, void *vg,              \
+                  target_ulong addr, uint32_t desc)        \
+{                                                          \
+    intptr_t i, oprsz = simd_oprsz(desc);                  \
+    intptr_t ra = GETPC();                                 \
+    unsigned rd = simd_data(desc);                         \
+    void *d1 = &env->vfp.zregs[rd];                        \
+    void *d2 = &env->vfp.zregs[(rd + 1) & 31];             \
+    void *d3 = &env->vfp.zregs[(rd + 2) & 31];             \
+    for (i = 0; i < oprsz; ) {                             \
+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));    \
+        do {                                               \
+            TYPEM m1 = 0, m2 = 0, m3 = 0;                  \
+            if (pg & 1) {                                  \
+                m1 = FN(env, addr, ra);                    \
+                m2 = FN(env, addr + sizeof(TYPEM), ra);    \
+                m3 = FN(env, addr + 2 * sizeof(TYPEM), ra); \
+            }                                              \
+            *(TYPEE *)(d1 + H(i)) = m1;                    \
+            *(TYPEE *)(d2 + H(i)) = m2;                    \
+            *(TYPEE *)(d3 + H(i)) = m3;                    \
+            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);      \
+            addr += 3 * sizeof(TYPEM);                     \
+        } while (i & 15);                                  \
+    }                                                      \
+}
+
+#define DO_LD4(NAME, FN, TYPEE, TYPEM, H)                  \
+void HELPER(NAME)(CPUARMState *env, void *vg,              \
+                  target_ulong addr, uint32_t desc)        \
+{                                                          \
+    intptr_t i, oprsz = simd_oprsz(desc);                  \
+    intptr_t ra = GETPC();                                 \
+    unsigned rd = simd_data(desc);                         \
+    void *d1 = &env->vfp.zregs[rd];                        \
+    void *d2 = &env->vfp.zregs[(rd + 1) & 31];             \
+    void *d3 = &env->vfp.zregs[(rd + 2) & 31];             \
+    void *d4 = &env->vfp.zregs[(rd + 3) & 31];             \
+    for (i = 0; i < oprsz; ) {                             \
+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));    \
+        do {                                               \
+            TYPEM m1 = 0, m2 = 0, m3 = 0, m4 = 0;          \
+            if (pg & 1) {                                  \
+                m1 = FN(env, addr, ra);                    \
+                m2 = FN(env, addr + sizeof(TYPEM), ra);    \
+                m3 = FN(env, addr + 2 * sizeof(TYPEM), ra); \
+                m4 = FN(env, addr + 3 * sizeof(TYPEM), ra); \
+            }                                              \
+            *(TYPEE *)(d1 + H(i)) = m1;                    \
+            *(TYPEE *)(d2 + H(i)) = m2;                    \
+            *(TYPEE *)(d3 + H(i)) = m3;                    \
+            *(TYPEE *)(d4 + H(i)) = m4;                    \
+            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);      \
+            addr += 4 * sizeof(TYPEM);                     \
+        } while (i & 15);                                  \
+    }                                                      \
+}
+
+DO_LD1(sve_ld1bhu_r, cpu_ldub_data_ra, uint16_t, uint8_t, H1_2)
+DO_LD1(sve_ld1bhs_r, cpu_ldsb_data_ra, uint16_t, int8_t, H1_2)
+DO_LD1(sve_ld1bsu_r, cpu_ldub_data_ra, uint32_t, uint8_t, H1_4)
+DO_LD1(sve_ld1bss_r, cpu_ldsb_data_ra, uint32_t, int8_t, H1_4)
+DO_LD1(sve_ld1bdu_r, cpu_ldub_data_ra, uint64_t, uint8_t, )
+DO_LD1(sve_ld1bds_r, cpu_ldsb_data_ra, uint64_t, int8_t, )
+
+DO_LD1(sve_ld1hsu_r, cpu_lduw_data_ra, uint32_t, uint16_t, H1_4)
+DO_LD1(sve_ld1hss_r, cpu_ldsw_data_ra, uint32_t, int8_t, H1_4)
+DO_LD1(sve_ld1hdu_r, cpu_lduw_data_ra, uint64_t, uint16_t, )
+DO_LD1(sve_ld1hds_r, cpu_ldsw_data_ra, uint64_t, int16_t, )
+
+DO_LD1(sve_ld1sdu_r, cpu_ldl_data_ra, uint64_t, uint32_t, )
+DO_LD1(sve_ld1sds_r, cpu_ldl_data_ra, uint64_t, int32_t, )
+
+DO_LD1(sve_ld1bb_r, cpu_ldub_data_ra, uint8_t, uint8_t, H1)
+DO_LD2(sve_ld2bb_r, cpu_ldub_data_ra, uint8_t, uint8_t, H1)
+DO_LD3(sve_ld3bb_r, cpu_ldub_data_ra, uint8_t, uint8_t, H1)
+DO_LD4(sve_ld4bb_r, cpu_ldub_data_ra, uint8_t, uint8_t, H1)
+
+DO_LD1(sve_ld1hh_r, cpu_lduw_data_ra, uint16_t, uint16_t, H1_2)
+DO_LD2(sve_ld2hh_r, cpu_lduw_data_ra, uint16_t, uint16_t, H1_2)
+DO_LD3(sve_ld3hh_r, cpu_lduw_data_ra, uint16_t, uint16_t, H1_2)
+DO_LD4(sve_ld4hh_r, cpu_lduw_data_ra, uint16_t, uint16_t, H1_2)
+
+DO_LD1(sve_ld1ss_r, cpu_ldl_data_ra, uint32_t, uint32_t, H1_4)
+DO_LD2(sve_ld2ss_r, cpu_ldl_data_ra, uint32_t, uint32_t, H1_4)
+DO_LD3(sve_ld3ss_r, cpu_ldl_data_ra, uint32_t, uint32_t, H1_4)
+DO_LD4(sve_ld4ss_r, cpu_ldl_data_ra, uint32_t, uint32_t, H1_4)
+
+DO_LD1(sve_ld1dd_r, cpu_ldq_data_ra, uint64_t, uint64_t, )
+DO_LD2(sve_ld2dd_r, cpu_ldq_data_ra, uint64_t, uint64_t, )
+DO_LD3(sve_ld3dd_r, cpu_ldq_data_ra, uint64_t, uint64_t, )
+DO_LD4(sve_ld4dd_r, cpu_ldq_data_ra, uint64_t, uint64_t, )
+
+#undef DO_LD1
+#undef DO_LD2
+#undef DO_LD3
+#undef DO_LD4
diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ typedef void gen_helper_gvec_flags_3(TCGv_i32, TCGv_ptr, TCGv_ptr,
 typedef void gen_helper_gvec_flags_4(TCGv_i32, TCGv_ptr, TCGv_ptr,
                                      TCGv_ptr, TCGv_ptr, TCGv_i32);
 
+typedef void gen_helper_gvec_mem(TCGv_env, TCGv_ptr, TCGv_i64, TCGv_i32);
+
 /*
  * Helpers for extracting complex instruction fields.
  */
@@ -XXX,XX +XXX,XX @@ static inline int expand_imm_sh8u(int x)
     return (uint8_t)x << (x & 0x100 ? 8 : 0);
 }
 
+/* Convert a 2-bit memory size (msz) to a 4-bit data type (dtype)
+ * with unsigned data.  C.f. SVE Memory Contiguous Load Group.
+ */
+static inline int msz_dtype(int msz)
+{
+    static const uint8_t dtype[4] = { 0, 5, 10, 15 };
+    return dtype[msz];
+}
+
 /*
  * Include the generated decoder.
  */
@@ -XXX,XX +XXX,XX @@ static bool trans_LDR_pri(DisasContext *s, arg_rri *a, uint32_t insn)
     }
     return true;
 }
+
+/*
+ *** SVE Memory - Contiguous Load Group
+ */
+
+/* The memory mode of the dtype.  */
+static const TCGMemOp dtype_mop[16] = {
+    MO_UB, MO_UB, MO_UB, MO_UB,
+    MO_SL, MO_UW, MO_UW, MO_UW,
+    MO_SW, MO_SW, MO_UL, MO_UL,
+    MO_SB, MO_SB, MO_SB, MO_Q
+};
+
+#define dtype_msz(x)  (dtype_mop[x] & MO_SIZE)
+
+/* The vector element size of dtype.  */
+static const uint8_t dtype_esz[16] = {
+    0, 1, 2, 3,
+    3, 1, 2, 3,
+    3, 2, 2, 3,
+    3, 2, 1, 3
+};
+
+static void do_mem_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
+                       gen_helper_gvec_mem *fn)
+{
+    unsigned vsz = vec_full_reg_size(s);
+    TCGv_ptr t_pg;
+    TCGv_i32 desc;
+
+    /* For e.g. LD4, there are not enough arguments to pass all 4
+     * registers as pointers, so encode the regno into the data field.
+     * For consistency, do this even for LD1.
+     */
+    desc = tcg_const_i32(simd_desc(vsz, vsz, zt));
+    t_pg = tcg_temp_new_ptr();
+
+    tcg_gen_addi_ptr(t_pg, cpu_env, pred_full_reg_offset(s, pg));
+    fn(cpu_env, t_pg, addr, desc);
+
+    tcg_temp_free_ptr(t_pg);
+    tcg_temp_free_i32(desc);
+}
+
+static void do_ld_zpa(DisasContext *s, int zt, int pg,
+                      TCGv_i64 addr, int dtype, int nreg)
+{
+    static gen_helper_gvec_mem * const fns[16][4] = {
+        { gen_helper_sve_ld1bb_r, gen_helper_sve_ld2bb_r,
+          gen_helper_sve_ld3bb_r, gen_helper_sve_ld4bb_r },
+        { gen_helper_sve_ld1bhu_r, NULL, NULL, NULL },
+        { gen_helper_sve_ld1bsu_r, NULL, NULL, NULL },
+        { gen_helper_sve_ld1bdu_r, NULL, NULL, NULL },
+
+        { gen_helper_sve_ld1sds_r, NULL, NULL, NULL },
+        { gen_helper_sve_ld1hh_r, gen_helper_sve_ld2hh_r,
+          gen_helper_sve_ld3hh_r, gen_helper_sve_ld4hh_r },
+        { gen_helper_sve_ld1hsu_r, NULL, NULL, NULL },
+        { gen_helper_sve_ld1hdu_r, NULL, NULL, NULL },
+
+        { gen_helper_sve_ld1hds_r, NULL, NULL, NULL },
+        { gen_helper_sve_ld1hss_r, NULL, NULL, NULL },
+        { gen_helper_sve_ld1ss_r, gen_helper_sve_ld2ss_r,
+          gen_helper_sve_ld3ss_r, gen_helper_sve_ld4ss_r },
+        { gen_helper_sve_ld1sdu_r, NULL, NULL, NULL },
+
+        { gen_helper_sve_ld1bds_r, NULL, NULL, NULL },
+        { gen_helper_sve_ld1bss_r, NULL, NULL, NULL },
+        { gen_helper_sve_ld1bhs_r, NULL, NULL, NULL },
+        { gen_helper_sve_ld1dd_r, gen_helper_sve_ld2dd_r,
+          gen_helper_sve_ld3dd_r, gen_helper_sve_ld4dd_r },
+    };
+    gen_helper_gvec_mem *fn = fns[dtype][nreg];
+
+    /* While there are holes in the table, they are not
+     * accessible via the instruction encoding.
+     */
+    assert(fn != NULL);
+    do_mem_zpa(s, zt, pg, addr, fn);
+}
+
+static bool trans_LD_zprr(DisasContext *s, arg_rprr_load *a, uint32_t insn)
+{
+    if (a->rm == 31) {
+        return false;
+    }
+    if (sve_access_check(s)) {
+        TCGv_i64 addr = new_tmp_a64(s);
+        tcg_gen_muli_i64(addr, cpu_reg(s, a->rm),
+                         (a->nreg + 1) << dtype_msz(a->dtype));
+        tcg_gen_add_i64(addr, addr, cpu_reg_sp(s, a->rn));
+        do_ld_zpa(s, a->rd, a->pg, addr, a->dtype, a->nreg);
+    }
+    return true;
+}
+
+static bool trans_LD_zpri(DisasContext *s, arg_rpri_load *a, uint32_t insn)
+{
+    if (sve_access_check(s)) {
+        int vsz = vec_full_reg_size(s);
+        int elements = vsz >> dtype_esz[a->dtype];
+        TCGv_i64 addr = new_tmp_a64(s);
+
+        tcg_gen_addi_i64(addr, cpu_reg_sp(s, a->rn),
+                         (a->imm * elements * (a->nreg + 1))
+                         << dtype_msz(a->dtype));
+        do_ld_zpa(s, a->rd, a->pg, addr, a->dtype, a->nreg);
+    }
+    return true;
+}
diff --git a/target/arm/sve.decode b/target/arm/sve.decode
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve.decode
+++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@
 # Unsigned 8-bit immediate, optionally shifted left by 8.
 %sh8_i8u        5:9 !function=expand_imm_sh8u
 
+# Unsigned load of msz into esz=2, represented as a dtype.
+%msz_dtype      23:2 !function=msz_dtype
+
 # Either a copy of rd (at bit 0), or a different source
 # as propagated via the MOVPRFX instruction.
 %reg_movprfx    0:5
@@ -XXX,XX +XXX,XX @@
 &incdec2_cnt    rd rn pat esz imm d u
 &incdec_pred    rd pg esz d u
 &incdec2_pred   rd rn pg esz d u
+&rprr_load      rd pg rn rm dtype nreg
+&rpri_load      rd pg rn imm dtype nreg
 
 ###########################################################################
 # Named instruction formats.  These are generally used to
@@ -XXX,XX +XXX,XX @@
 @incdec2_pred   ........ esz:2 .... .. ..... .. pg:4 rd:5 \
                 &incdec2_pred rn=%reg_movprfx
 
+# Loads; user must fill in NREG.
+@rprr_load_dt   ....... dtype:4 rm:5 ... pg:3 rn:5 rd:5         &rprr_load
+@rpri_load_dt   ....... dtype:4 . imm:s4 ... pg:3 rn:5 rd:5     &rpri_load
+
+@rprr_load_msz  ....... .... rm:5 ... pg:3 rn:5 rd:5 \
+                &rprr_load dtype=%msz_dtype
+@rpri_load_msz  ....... .... . imm:s4 ... pg:3 rn:5 rd:5 \
+                &rpri_load dtype=%msz_dtype
+
 ###########################################################################
 # Instruction patterns.  Grouped according to the SVE encodingindex.xhtml.
 
@@ -XXX,XX +XXX,XX @@ LDR_pri         10000101 10 ...... 000 ... ..... 0 ....         @pd_rn_i9
 
 # SVE load vector register
 LDR_zri         10000101 10 ...... 010 ... ..... .....          @rd_rn_i9
+
+### SVE Memory Contiguous Load Group
+
+# SVE contiguous load (scalar plus scalar)
+LD_zprr         1010010 .... ..... 010 ... ..... .....    @rprr_load_dt nreg=0
+
+# SVE contiguous load (scalar plus immediate)
+LD_zpri         1010010 .... 0.... 101 ... ..... .....    @rpri_load_dt nreg=0
+
+# SVE contiguous non-temporal load (scalar plus scalar)
+# LDNT1B, LDNT1H, LDNT1W, LDNT1D
+# SVE load multiple structures (scalar plus scalar)
+# LD2B, LD2H, LD2W, LD2D; etc.
+LD_zprr         1010010 .. nreg:2 ..... 110 ... ..... .....     @rprr_load_msz
+
+# SVE contiguous non-temporal load (scalar plus immediate)
+# LDNT1B, LDNT1H, LDNT1W, LDNT1D
+# SVE load multiple structures (scalar plus immediate)
+# LD2B, LD2H, LD2W, LD2D; etc.
+LD_zpri         1010010 .. nreg:2 0.... 111 ... ..... .....     @rpri_load_msz
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Alex Bennée <alex.bennee@linaro.org>
Tested-by: Alex Bennée <alex.bennee@linaro.org>
Message-id: 20180627043328.11531-3-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    |  40 ++++++++++
 target/arm/sve_helper.c    | 157 +++++++++++++++++++++++++++++++++++++
 target/arm/translate-sve.c |  69 ++++++++++++++++
 target/arm/sve.decode      |   6 ++
 4 files changed, 272 insertions(+)

diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper-sve.h
+++ b/target/arm/helper-sve.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_4(sve_ld1hds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 
 DEF_HELPER_FLAGS_4(sve_ld1sdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 DEF_HELPER_FLAGS_4(sve_ld1sds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ldff1bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldff1bhu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldff1bsu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldff1bdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldff1bhs_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldff1bss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldff1bds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ldff1hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldff1hsu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldff1hdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldff1hss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldff1hds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ldff1ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldff1sdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldff1sds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ldff1dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ldnf1bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldnf1bhu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldnf1bsu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldnf1bdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldnf1bhs_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldnf1bss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldnf1bds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ldnf1hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldnf1hsu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldnf1hdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldnf1hss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldnf1hds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ldnf1ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldnf1sdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_ldnf1sds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_ldnf1dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve_helper.c
+++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ DO_LD4(sve_ld4dd_r, cpu_ldq_data_ra, uint64_t, uint64_t, )
 #undef DO_LD2
 #undef DO_LD3
 #undef DO_LD4
+
+/*
+ * Load contiguous data, first-fault and no-fault.
+ */
+
+#ifdef CONFIG_USER_ONLY
+
+/* Fault on byte I.  All bits in FFR from I are cleared.  The vector
+ * result from I is CONSTRAINED UNPREDICTABLE; we choose the MERGE
+ * option, which leaves subsequent data unchanged.
+ */
+static void record_fault(CPUARMState *env, uintptr_t i, uintptr_t oprsz)
+{
+    uint64_t *ffr = env->vfp.pregs[FFR_PRED_NUM].p;
+
+    if (i & 63) {
+        ffr[i / 64] &= MAKE_64BIT_MASK(0, i & 63);
+        i = ROUND_UP(i, 64);
+    }
+    for (; i < oprsz; i += 64) {
+        ffr[i / 64] = 0;
+    }
+}
+
+/* Hold the mmap lock during the operation so that there is no race
+ * between page_check_range and the load operation.  We expect the
+ * usual case to have no faults at all, so we check the whole range
+ * first and if successful defer to the normal load operation.
+ *
+ * TODO: Change mmap_lock to a rwlock so that multiple readers
+ * can run simultaneously.  This will probably help other uses
+ * within QEMU as well.
+ */
+#define DO_LDFF1(PART, FN, TYPEE, TYPEM, H)                             \
+static void do_sve_ldff1##PART(CPUARMState *env, void *vd, void *vg,    \
+                               target_ulong addr, intptr_t oprsz,       \
+                               bool first, uintptr_t ra)                \
+{                                                                       \
+    intptr_t i = 0;                                                     \
+    do {                                                                \
+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));                 \
+        do {                                                            \
+            TYPEM m = 0;                                                \
+            if (pg & 1) {                                               \
+                if (!first &&                                           \
+                    unlikely(page_check_range(addr, sizeof(TYPEM),      \
+                                              PAGE_READ))) {            \
+                    record_fault(env, i, oprsz);                        \
+                    return;                                             \
+                }                                                       \
+                m = FN(env, addr, ra);                                  \
+                first = false;                                          \
+            }                                                           \
+            *(TYPEE *)(vd + H(i)) = m;                                  \
+            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);                   \
+            addr += sizeof(TYPEM);                                      \
+        } while (i & 15);                                               \
+    } while (i < oprsz);                                                \
+}                                                                       \
+void HELPER(sve_ldff1##PART)(CPUARMState *env, void *vg,                \
+                             target_ulong addr, uint32_t desc)          \
+{                                                                       \
+    intptr_t oprsz = simd_oprsz(desc);                                  \
+    unsigned rd = simd_data(desc);                                      \
+    void *vd = &env->vfp.zregs[rd];                                     \
+    mmap_lock();                                                        \
+    if (likely(page_check_range(addr, oprsz, PAGE_READ) == 0)) {        \
+        do_sve_ld1##PART(env, vd, vg, addr, oprsz, GETPC());            \
+    } else {                                                            \
+        do_sve_ldff1##PART(env, vd, vg, addr, oprsz, true, GETPC());    \
+    }                                                                   \
+    mmap_unlock();                                                      \
+}
+
+/* No-fault loads are like first-fault loads without the
+ * first faulting special case.
+ */
+#define DO_LDNF1(PART)                                                  \
+void HELPER(sve_ldnf1##PART)(CPUARMState *env, void *vg,                \
+                             target_ulong addr, uint32_t desc)          \
+{                                                                       \
+    intptr_t oprsz = simd_oprsz(desc);                                  \
+    unsigned rd = simd_data(desc);                                      \
+    void *vd = &env->vfp.zregs[rd];                                     \
+    mmap_lock();                                                        \
+    if (likely(page_check_range(addr, oprsz, PAGE_READ) == 0)) {        \
+        do_sve_ld1##PART(env, vd, vg, addr, oprsz, GETPC());            \
+    } else {                                                            \
+        do_sve_ldff1##PART(env, vd, vg, addr, oprsz, false, GETPC());   \
+    }                                                                   \
+    mmap_unlock();                                                      \
+}
+
+#else
+
+/* TODO: System mode is not yet supported.
+ * This would probably use tlb_vaddr_to_host.
+ */
+#define DO_LDFF1(PART, FN, TYPEE, TYPEM, H)                     \
+void HELPER(sve_ldff1##PART)(CPUARMState *env, void *vg,        \
+                  target_ulong addr, uint32_t desc)             \
+{                                                               \
+    g_assert_not_reached();                                     \
+}
+
+#define DO_LDNF1(PART)                                          \
+void HELPER(sve_ldnf1##PART)(CPUARMState *env, void *vg,        \
+                  target_ulong addr, uint32_t desc)             \
+{                                                               \
+    g_assert_not_reached();                                     \
+}
+
+#endif
+
+DO_LDFF1(bb_r,  cpu_ldub_data_ra, uint8_t, uint8_t, H1)
+DO_LDFF1(bhu_r, cpu_ldub_data_ra, uint16_t, uint8_t, H1_2)
+DO_LDFF1(bhs_r, cpu_ldsb_data_ra, uint16_t, int8_t, H1_2)
+DO_LDFF1(bsu_r, cpu_ldub_data_ra, uint32_t, uint8_t, H1_4)
+DO_LDFF1(bss_r, cpu_ldsb_data_ra, uint32_t, int8_t, H1_4)
+DO_LDFF1(bdu_r, cpu_ldub_data_ra, uint64_t, uint8_t, )
+DO_LDFF1(bds_r, cpu_ldsb_data_ra, uint64_t, int8_t, )
+
+DO_LDFF1(hh_r,  cpu_lduw_data_ra, uint16_t, uint16_t, H1_2)
+DO_LDFF1(hsu_r, cpu_lduw_data_ra, uint32_t, uint16_t, H1_4)
+DO_LDFF1(hss_r, cpu_ldsw_data_ra, uint32_t, int8_t, H1_4)
+DO_LDFF1(hdu_r, cpu_lduw_data_ra, uint64_t, uint16_t, )
+DO_LDFF1(hds_r, cpu_ldsw_data_ra, uint64_t, int16_t, )
+
+DO_LDFF1(ss_r,  cpu_ldl_data_ra, uint32_t, uint32_t, H1_4)
+DO_LDFF1(sdu_r, cpu_ldl_data_ra, uint64_t, uint32_t, )
+DO_LDFF1(sds_r, cpu_ldl_data_ra, uint64_t, int32_t, )
+
+DO_LDFF1(dd_r,  cpu_ldq_data_ra, uint64_t, uint64_t, )
+
+#undef DO_LDFF1
+
+DO_LDNF1(bb_r)
+DO_LDNF1(bhu_r)
+DO_LDNF1(bhs_r)
+DO_LDNF1(bsu_r)
+DO_LDNF1(bss_r)
+DO_LDNF1(bdu_r)
+DO_LDNF1(bds_r)
+
+DO_LDNF1(hh_r)
+DO_LDNF1(hsu_r)
+DO_LDNF1(hss_r)
+DO_LDNF1(hdu_r)
+DO_LDNF1(hds_r)
+
+DO_LDNF1(ss_r)
+DO_LDNF1(sdu_r)
+DO_LDNF1(sds_r)
+
+DO_LDNF1(dd_r)
+
+#undef DO_LDNF1
diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_LD_zpri(DisasContext *s, arg_rpri_load *a, uint32_t insn)
     }
     return true;
 }
+
+static bool trans_LDFF1_zprr(DisasContext *s, arg_rprr_load *a, uint32_t insn)
+{
+    static gen_helper_gvec_mem * const fns[16] = {
+        gen_helper_sve_ldff1bb_r,
+        gen_helper_sve_ldff1bhu_r,
+        gen_helper_sve_ldff1bsu_r,
+        gen_helper_sve_ldff1bdu_r,
+
+        gen_helper_sve_ldff1sds_r,
+        gen_helper_sve_ldff1hh_r,
+        gen_helper_sve_ldff1hsu_r,
+        gen_helper_sve_ldff1hdu_r,
+
+        gen_helper_sve_ldff1hds_r,
+        gen_helper_sve_ldff1hss_r,
+        gen_helper_sve_ldff1ss_r,
+        gen_helper_sve_ldff1sdu_r,
+
+        gen_helper_sve_ldff1bds_r,
+        gen_helper_sve_ldff1bss_r,
+        gen_helper_sve_ldff1bhs_r,
+        gen_helper_sve_ldff1dd_r,
+    };
+
+    if (sve_access_check(s)) {
+        TCGv_i64 addr = new_tmp_a64(s);
+        tcg_gen_shli_i64(addr, cpu_reg(s, a->rm), dtype_msz(a->dtype));
+        tcg_gen_add_i64(addr, addr, cpu_reg_sp(s, a->rn));
+        do_mem_zpa(s, a->rd, a->pg, addr, fns[a->dtype]);
+    }
+    return true;
+}
+
+static bool trans_LDNF1_zpri(DisasContext *s, arg_rpri_load *a, uint32_t insn)
+{
+    static gen_helper_gvec_mem * const fns[16] = {
+        gen_helper_sve_ldnf1bb_r,
+        gen_helper_sve_ldnf1bhu_r,
+        gen_helper_sve_ldnf1bsu_r,
+        gen_helper_sve_ldnf1bdu_r,
+
+        gen_helper_sve_ldnf1sds_r,
+        gen_helper_sve_ldnf1hh_r,
+        gen_helper_sve_ldnf1hsu_r,
+        gen_helper_sve_ldnf1hdu_r,
+
+        gen_helper_sve_ldnf1hds_r,
+        gen_helper_sve_ldnf1hss_r,
+        gen_helper_sve_ldnf1ss_r,
+        gen_helper_sve_ldnf1sdu_r,
+
+        gen_helper_sve_ldnf1bds_r,
+        gen_helper_sve_ldnf1bss_r,
+        gen_helper_sve_ldnf1bhs_r,
+        gen_helper_sve_ldnf1dd_r,
+    };
+
+    if (sve_access_check(s)) {
+        int vsz = vec_full_reg_size(s);
+        int elements = vsz >> dtype_esz[a->dtype];
+        int off = (a->imm * elements) << dtype_msz(a->dtype);
+        TCGv_i64 addr = new_tmp_a64(s);
+
+        tcg_gen_addi_i64(addr, cpu_reg_sp(s, a->rn), off);
+        do_mem_zpa(s, a->rd, a->pg, addr, fns[a->dtype]);
+    }
+    return true;
+}
diff --git a/target/arm/sve.decode b/target/arm/sve.decode
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve.decode
+++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@ LDR_zri         10000101 10 ...... 010 ... ..... .....          @rd_rn_i9
 # SVE contiguous load (scalar plus scalar)
 LD_zprr         1010010 .... ..... 010 ... ..... .....    @rprr_load_dt nreg=0
 
+# SVE contiguous first-fault load (scalar plus scalar)
+LDFF1_zprr      1010010 .... ..... 011 ... ..... .....    @rprr_load_dt nreg=0
+
 # SVE contiguous load (scalar plus immediate)
 LD_zpri         1010010 .... 0.... 101 ... ..... .....    @rpri_load_dt nreg=0
 
+# SVE contiguous non-fault load (scalar plus immediate)
+LDNF1_zpri      1010010 .... 1.... 101 ... ..... .....    @rpri_load_dt nreg=0
+
 # SVE contiguous non-temporal load (scalar plus scalar)
 # LDNT1B, LDNT1H, LDNT1W, LDNT1D
 # SVE load multiple structures (scalar plus scalar)
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-4-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    |  29 +++++
 target/arm/sve_helper.c    | 211 +++++++++++++++++++++++++++++++++++++
 target/arm/translate-sve.c |  65 ++++++++++++
 target/arm/sve.decode      |  38 +++++++
 4 files changed, 343 insertions(+)

diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper-sve.h
+++ b/target/arm/helper-sve.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_4(sve_ldnf1sdu_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 DEF_HELPER_FLAGS_4(sve_ldnf1sds_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 
 DEF_HELPER_FLAGS_4(sve_ldnf1dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_st1bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_st2bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_st3bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_st4bb_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_st1hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_st2hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_st3hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_st4hh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_st1ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_st2ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_st3ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_st4ss_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_st1dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_st2dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_st3dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_st4dd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_st1bh_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_st1bs_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_st1bd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_st1hs_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+DEF_HELPER_FLAGS_4(sve_st1hd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_4(sve_st1sd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve_helper.c
+++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ DO_LDNF1(sds_r)
 DO_LDNF1(dd_r)
 
 #undef DO_LDNF1
+
+/*
+ * Store contiguous data, protected by a governing predicate.
+ */
+#define DO_ST1(NAME, FN, TYPEE, TYPEM, H)                  \
+void HELPER(NAME)(CPUARMState *env, void *vg,              \
+                  target_ulong addr, uint32_t desc)        \
+{                                                          \
+    intptr_t i, oprsz = simd_oprsz(desc);                  \
+    intptr_t ra = GETPC();                                 \
+    unsigned rd = simd_data(desc);                         \
+    void *vd = &env->vfp.zregs[rd];                        \
+    for (i = 0; i < oprsz; ) {                             \
+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));    \
+        do {                                               \
+            if (pg & 1) {                                  \
+                TYPEM m = *(TYPEE *)(vd + H(i));           \
+                FN(env, addr, m, ra);                      \
+            }                                              \
+            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);      \
+            addr += sizeof(TYPEM);                         \
+        } while (i & 15);                                  \
+    }                                                      \
+}
+
+#define DO_ST1_D(NAME, FN, TYPEM)                          \
+void HELPER(NAME)(CPUARMState *env, void *vg,              \
+                  target_ulong addr, uint32_t desc)        \
+{                                                          \
+    intptr_t i, oprsz = simd_oprsz(desc) / 8;              \
+    intptr_t ra = GETPC();                                 \
+    unsigned rd = simd_data(desc);                         \
+    uint64_t *d = &env->vfp.zregs[rd].d[0];                \
+    uint8_t *pg = vg;                                      \
+    for (i = 0; i < oprsz; i += 1) {                       \
+        if (pg[H1(i)] & 1) {                               \
+            FN(env, addr, d[i], ra);                       \
+        }                                                  \
+        addr += sizeof(TYPEM);                             \
+    }                                                      \
+}
+
+#define DO_ST2(NAME, FN, TYPEE, TYPEM, H)                  \
+void HELPER(NAME)(CPUARMState *env, void *vg,              \
+                  target_ulong addr, uint32_t desc)        \
+{                                                          \
+    intptr_t i, oprsz = simd_oprsz(desc);                  \
+    intptr_t ra = GETPC();                                 \
+    unsigned rd = simd_data(desc);                         \
+    void *d1 = &env->vfp.zregs[rd];                        \
+    void *d2 = &env->vfp.zregs[(rd + 1) & 31];             \
+    for (i = 0; i < oprsz; ) {                             \
+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));    \
+        do {                                               \
+            if (pg & 1) {                                  \
+                TYPEM m1 = *(TYPEE *)(d1 + H(i));          \
+                TYPEM m2 = *(TYPEE *)(d2 + H(i));          \
+                FN(env, addr, m1, ra);                     \
+                FN(env, addr + sizeof(TYPEM), m2, ra);     \
+            }                                              \
+            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);      \
+            addr += 2 * sizeof(TYPEM);                     \
+        } while (i & 15);                                  \
+    }                                                      \
+}
+
+#define DO_ST3(NAME, FN, TYPEE, TYPEM, H)                  \
+void HELPER(NAME)(CPUARMState *env, void *vg,              \
+                  target_ulong addr, uint32_t desc)        \
+{                                                          \
+    intptr_t i, oprsz = simd_oprsz(desc);                  \
+    intptr_t ra = GETPC();                                 \
+    unsigned rd = simd_data(desc);                         \
+    void *d1 = &env->vfp.zregs[rd];                        \
+    void *d2 = &env->vfp.zregs[(rd + 1) & 31];             \
+    void *d3 = &env->vfp.zregs[(rd + 2) & 31];             \
+    for (i = 0; i < oprsz; ) {                             \
+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));    \
+        do {                                               \
+            if (pg & 1) {                                  \
+                TYPEM m1 = *(TYPEE *)(d1 + H(i));          \
+                TYPEM m2 = *(TYPEE *)(d2 + H(i));          \
+                TYPEM m3 = *(TYPEE *)(d3 + H(i));          \
+                FN(env, addr, m1, ra);                     \
+                FN(env, addr + sizeof(TYPEM), m2, ra);     \
+                FN(env, addr + 2 * sizeof(TYPEM), m3, ra); \
+            }                                              \
+            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);      \
+            addr += 3 * sizeof(TYPEM);                     \
+        } while (i & 15);                                  \
+    }                                                      \
+}
+
+#define DO_ST4(NAME, FN, TYPEE, TYPEM, H)                  \
+void HELPER(NAME)(CPUARMState *env, void *vg,              \
+                  target_ulong addr, uint32_t desc)        \
+{                                                          \
+    intptr_t i, oprsz = simd_oprsz(desc);                  \
+    intptr_t ra = GETPC();                                 \
+    unsigned rd = simd_data(desc);                         \
+    void *d1 = &env->vfp.zregs[rd];                        \
+    void *d2 = &env->vfp.zregs[(rd + 1) & 31];             \
+    void *d3 = &env->vfp.zregs[(rd + 2) & 31];             \
+    void *d4 = &env->vfp.zregs[(rd + 3) & 31];             \
+    for (i = 0; i < oprsz; ) {                             \
+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));    \
+        do {                                               \
+            if (pg & 1) {                                  \
+                TYPEM m1 = *(TYPEE *)(d1 + H(i));          \
+                TYPEM m2 = *(TYPEE *)(d2 + H(i));          \
+                TYPEM m3 = *(TYPEE *)(d3 + H(i));          \
+                TYPEM m4 = *(TYPEE *)(d4 + H(i));          \
+                FN(env, addr, m1, ra);                     \
+                FN(env, addr + sizeof(TYPEM), m2, ra);     \
+                FN(env, addr + 2 * sizeof(TYPEM), m3, ra); \
+                FN(env, addr + 3 * sizeof(TYPEM), m4, ra); \
+            }                                              \
+            i += sizeof(TYPEE), pg >>= sizeof(TYPEE);      \
+            addr += 4 * sizeof(TYPEM);                     \
+        } while (i & 15);                                  \
+    }                                                      \
+}
+
+DO_ST1(sve_st1bh_r, cpu_stb_data_ra, uint16_t, uint8_t, H1_2)
+DO_ST1(sve_st1bs_r, cpu_stb_data_ra, uint32_t, uint8_t, H1_4)
+DO_ST1_D(sve_st1bd_r, cpu_stb_data_ra, uint8_t)
+
+DO_ST1(sve_st1hs_r, cpu_stw_data_ra, uint32_t, uint16_t, H1_4)
+DO_ST1_D(sve_st1hd_r, cpu_stw_data_ra, uint16_t)
+
+DO_ST1_D(sve_st1sd_r, cpu_stl_data_ra, uint32_t)
+
+DO_ST1(sve_st1bb_r, cpu_stb_data_ra, uint8_t, uint8_t, H1)
+DO_ST2(sve_st2bb_r, cpu_stb_data_ra, uint8_t, uint8_t, H1)
+DO_ST3(sve_st3bb_r, cpu_stb_data_ra, uint8_t, uint8_t, H1)
+DO_ST4(sve_st4bb_r, cpu_stb_data_ra, uint8_t, uint8_t, H1)
+
+DO_ST1(sve_st1hh_r, cpu_stw_data_ra, uint16_t, uint16_t, H1_2)
+DO_ST2(sve_st2hh_r, cpu_stw_data_ra, uint16_t, uint16_t, H1_2)
+DO_ST3(sve_st3hh_r, cpu_stw_data_ra, uint16_t, uint16_t, H1_2)
+DO_ST4(sve_st4hh_r, cpu_stw_data_ra, uint16_t, uint16_t, H1_2)
+
+DO_ST1(sve_st1ss_r, cpu_stl_data_ra, uint32_t, uint32_t, H1_4)
+DO_ST2(sve_st2ss_r, cpu_stl_data_ra, uint32_t, uint32_t, H1_4)
+DO_ST3(sve_st3ss_r, cpu_stl_data_ra, uint32_t, uint32_t, H1_4)
+DO_ST4(sve_st4ss_r, cpu_stl_data_ra, uint32_t, uint32_t, H1_4)
+
+DO_ST1_D(sve_st1dd_r, cpu_stq_data_ra, uint64_t)
+
+void HELPER(sve_st2dd_r)(CPUARMState *env, void *vg,
+                         target_ulong addr, uint32_t desc)
+{
+    intptr_t i, oprsz = simd_oprsz(desc) / 8;
+    intptr_t ra = GETPC();
+    unsigned rd = simd_data(desc);
+    uint64_t *d1 = &env->vfp.zregs[rd].d[0];
+    uint64_t *d2 = &env->vfp.zregs[(rd + 1) & 31].d[0];
+    uint8_t *pg = vg;
+
+    for (i = 0; i < oprsz; i += 1) {
+        if (pg[H1(i)] & 1) {
+            cpu_stq_data_ra(env, addr, d1[i], ra);
+            cpu_stq_data_ra(env, addr + 8, d2[i], ra);
+        }
+        addr += 2 * 8;
+    }
+}
+
+void HELPER(sve_st3dd_r)(CPUARMState *env, void *vg,
+                         target_ulong addr, uint32_t desc)
+{
+    intptr_t i, oprsz = simd_oprsz(desc) / 8;
+    intptr_t ra = GETPC();
+    unsigned rd = simd_data(desc);
+    uint64_t *d1 = &env->vfp.zregs[rd].d[0];
+    uint64_t *d2 = &env->vfp.zregs[(rd + 1) & 31].d[0];
+    uint64_t *d3 = &env->vfp.zregs[(rd + 2) & 31].d[0];
+    uint8_t *pg = vg;
+
+    for (i = 0; i < oprsz; i += 1) {
+        if (pg[H1(i)] & 1) {
+            cpu_stq_data_ra(env, addr, d1[i], ra);
+            cpu_stq_data_ra(env, addr + 8, d2[i], ra);
+            cpu_stq_data_ra(env, addr + 16, d3[i], ra);
+        }
+        addr += 3 * 8;
+    }
+}
+
+void HELPER(sve_st4dd_r)(CPUARMState *env, void *vg,
+                         target_ulong addr, uint32_t desc)
+{
+    intptr_t i, oprsz = simd_oprsz(desc) / 8;
+    intptr_t ra = GETPC();
+    unsigned rd = simd_data(desc);
+    uint64_t *d1 = &env->vfp.zregs[rd].d[0];
+    uint64_t *d2 = &env->vfp.zregs[(rd + 1) & 31].d[0];
+    uint64_t *d3 = &env->vfp.zregs[(rd + 2) & 31].d[0];
+    uint64_t *d4 = &env->vfp.zregs[(rd + 3) & 31].d[0];
+    uint8_t *pg = vg;
+
+    for (i = 0; i < oprsz; i += 1) {
+        if (pg[H1(i)] & 1) {
+            cpu_stq_data_ra(env, addr, d1[i], ra);
+            cpu_stq_data_ra(env, addr + 8, d2[i], ra);
+            cpu_stq_data_ra(env, addr + 16, d3[i], ra);
+            cpu_stq_data_ra(env, addr + 24, d4[i], ra);
+        }
+        addr += 4 * 8;
+    }
+}
diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_LDNF1_zpri(DisasContext *s, arg_rpri_load *a, uint32_t insn)
     }
     return true;
 }
+
+static void do_st_zpa(DisasContext *s, int zt, int pg, TCGv_i64 addr,
+                      int msz, int esz, int nreg)
+{
+    static gen_helper_gvec_mem * const fn_single[4][4] = {
+        { gen_helper_sve_st1bb_r, gen_helper_sve_st1bh_r,
+          gen_helper_sve_st1bs_r, gen_helper_sve_st1bd_r },
+        { NULL,                   gen_helper_sve_st1hh_r,
+          gen_helper_sve_st1hs_r, gen_helper_sve_st1hd_r },
+        { NULL, NULL,
+          gen_helper_sve_st1ss_r, gen_helper_sve_st1sd_r },
+        { NULL, NULL, NULL, gen_helper_sve_st1dd_r },
+    };
+    static gen_helper_gvec_mem * const fn_multiple[3][4] = {
+        { gen_helper_sve_st2bb_r, gen_helper_sve_st2hh_r,
+          gen_helper_sve_st2ss_r, gen_helper_sve_st2dd_r },
+        { gen_helper_sve_st3bb_r, gen_helper_sve_st3hh_r,
+          gen_helper_sve_st3ss_r, gen_helper_sve_st3dd_r },
+        { gen_helper_sve_st4bb_r, gen_helper_sve_st4hh_r,
+          gen_helper_sve_st4ss_r, gen_helper_sve_st4dd_r },
+    };
+    gen_helper_gvec_mem *fn;
+
+    if (nreg == 0) {
+        /* ST1 */
+        fn = fn_single[msz][esz];
+    } else {
+        /* ST2, ST3, ST4 -- msz == esz, enforced by encoding */
+        assert(msz == esz);
+        fn = fn_multiple[nreg - 1][msz];
+    }
+    assert(fn != NULL);
+    do_mem_zpa(s, zt, pg, addr, fn);
+}
+
+static bool trans_ST_zprr(DisasContext *s, arg_rprr_store *a, uint32_t insn)
+{
+    if (a->rm == 31 || a->msz > a->esz) {
+        return false;
+    }
+    if (sve_access_check(s)) {
+        TCGv_i64 addr = new_tmp_a64(s);
+        tcg_gen_muli_i64(addr, cpu_reg(s, a->rm), (a->nreg + 1) << a->msz);
+        tcg_gen_add_i64(addr, addr, cpu_reg_sp(s, a->rn));
+        do_st_zpa(s, a->rd, a->pg, addr, a->msz, a->esz, a->nreg);
+    }
+    return true;
+}
+
+static bool trans_ST_zpri(DisasContext *s, arg_rpri_store *a, uint32_t insn)
+{
+    if (a->msz > a->esz) {
+        return false;
+    }
+    if (sve_access_check(s)) {
+        int vsz = vec_full_reg_size(s);
+        int elements = vsz >> a->esz;
+        TCGv_i64 addr = new_tmp_a64(s);
+
+        tcg_gen_addi_i64(addr, cpu_reg_sp(s, a->rn),
+                         (a->imm * elements * (a->nreg + 1)) << a->msz);
+        do_st_zpa(s, a->rd, a->pg, addr, a->msz, a->esz, a->nreg);
+    }
+    return true;
+}
diff --git a/target/arm/sve.decode b/target/arm/sve.decode
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve.decode
+++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@
 %imm7_22_16     22:2 16:5
 %imm8_16_10     16:5 10:3
 %imm9_16_10     16:s6 10:3
+%size_23        23:2
 
 # A combination of tsz:imm3 -- extract esize.
 %tszimm_esz     22:2 5:5 !function=tszimm_esz
@@ -XXX,XX +XXX,XX @@
 &incdec2_pred   rd rn pg esz d u
 &rprr_load      rd pg rn rm dtype nreg
 &rpri_load      rd pg rn imm dtype nreg
+&rprr_store     rd pg rn rm msz esz nreg
+&rpri_store     rd pg rn imm msz esz nreg
 
 ###########################################################################
 # Named instruction formats.  These are generally used to
@@ -XXX,XX +XXX,XX @@
 @rpri_load_msz  ....... .... . imm:s4 ... pg:3 rn:5 rd:5 \
                 &rpri_load dtype=%msz_dtype
 
+# Stores; user must fill in ESZ, MSZ, NREG as needed.
+@rprr_store         ....... ..    ..     rm:5 ... pg:3 rn:5 rd:5    &rprr_store
+@rpri_store_msz     ....... msz:2 .. . imm:s4 ... pg:3 rn:5 rd:5    &rpri_store
+@rprr_store_esz_n0  ....... ..    esz:2  rm:5 ... pg:3 rn:5 rd:5 \
+                    &rprr_store nreg=0
+
 ###########################################################################
 # Instruction patterns.  Grouped according to the SVE encodingindex.xhtml.
 
@@ -XXX,XX +XXX,XX @@ LD_zprr         1010010 .. nreg:2 ..... 110 ... ..... .....     @rprr_load_msz
 # SVE load multiple structures (scalar plus immediate)
 # LD2B, LD2H, LD2W, LD2D; etc.
 LD_zpri         1010010 .. nreg:2 0.... 111 ... ..... .....     @rpri_load_msz
+
+### SVE Memory Store Group
+
+# SVE contiguous store (scalar plus immediate)
+# ST1B, ST1H, ST1W, ST1D; require msz <= esz
+ST_zpri         1110010 .. esz:2  0.... 111 ... ..... ..... \
+                @rpri_store_msz nreg=0
+
+# SVE contiguous store (scalar plus scalar)
+# ST1B, ST1H, ST1W, ST1D; require msz <= esz
+# Enumerate msz lest we conflict with STR_zri.
+ST_zprr         1110010 00 ..     ..... 010 ... ..... ..... \
+                @rprr_store_esz_n0 msz=0
+ST_zprr         1110010 01 ..     ..... 010 ... ..... ..... \
+                @rprr_store_esz_n0 msz=1
+ST_zprr         1110010 10 ..     ..... 010 ... ..... ..... \
+                @rprr_store_esz_n0 msz=2
+ST_zprr         1110010 11 11     ..... 010 ... ..... ..... \
+                @rprr_store msz=3 esz=3 nreg=0
+
+# SVE contiguous non-temporal store (scalar plus immediate)  (nreg == 0)
+# SVE store multiple structures (scalar plus immediate)      (nreg != 0)
+ST_zpri         1110010 .. nreg:2 1.... 111 ... ..... ..... \
+                @rpri_store_msz esz=%size_23
+
+# SVE contiguous non-temporal store (scalar plus scalar)     (nreg == 0)
+# SVE store multiple structures (scalar plus scalar)         (nreg != 0)
+ST_zprr         1110010 msz:2 nreg:2 ..... 011 ... ..... ..... \
+                @rprr_store esz=%size_23
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-5-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 52 ++++++++++++++++++++++++++++++++++++++
 target/arm/sve.decode      |  9 +++++++
 2 files changed, 61 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
[PMM: fixed typo]
Message-id: 20180627043328.11531-6-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    | 30 +++++++++++++
 target/arm/sve_helper.c    | 38 ++++++++++++++++
 target/arm/translate-sve.c | 90 ++++++++++++++++++++++++++++++++++++++
 target/arm/sve.decode      | 22 ++++++++++
 4 files changed, 180 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-7-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    | 77 +++++++++++++++++++++++++++++++++
 target/arm/sve_helper.c    | 89 ++++++++++++++++++++++++++++++++++++++
 target/arm/translate-sve.c | 46 ++++++++++++++++++++
 target/arm/sve.decode      | 17 ++++++++
 4 files changed, 229 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Alex Bennée <alex.bennee@linaro.org>
Message-id: 20180627043328.11531-8-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    |  16 ++++
 target/arm/sve_helper.c    | 158 +++++++++++++++++++++++++++++++++++++
 target/arm/translate-sve.c |  49 ++++++++++++
 target/arm/sve.decode      |  18 +++++
 4 files changed, 241 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-9-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    |  7 +++++
 target/arm/sve_helper.c    | 56 ++++++++++++++++++++++++++++++++++++++
 target/arm/translate-sve.c | 45 ++++++++++++++++++++++++++++++
 target/arm/sve.decode      |  5 ++++
 4 files changed, 113 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-10-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    |  5 +++
 target/arm/sve_helper.c    | 41 +++++++++++++++++++++++++
 target/arm/translate-sve.c | 62 ++++++++++++++++++++++++++++++++++++++
 target/arm/sve.decode      |  5 +++
 4 files changed, 113 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-11-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 103 +++++++++++++++++++++++++++++++++++++
 target/arm/sve.decode      |   6 +++
 2 files changed, 109 insertions(+)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static void do_ldr(DisasContext *s, uint32_t vofs, uint32_t len,
     tcg_temp_free_i64(t0);
 }
 
+/* Similarly for stores.  */
+static void do_str(DisasContext *s, uint32_t vofs, uint32_t len,
+                   int rn, int imm)
+{
+    uint32_t len_align = QEMU_ALIGN_DOWN(len, 8);
+    uint32_t len_remain = len % 8;
+    uint32_t nparts = len / 8 + ctpop8(len_remain);
+    int midx = get_mem_index(s);
+    TCGv_i64 addr, t0;
+
+    addr = tcg_temp_new_i64();
+    t0 = tcg_temp_new_i64();
+
+    /* Note that unpredicated load/store of vector/predicate registers
+     * are defined as a stream of bytes, which equates to little-endian
+     * operations on larger quantities.  There is no nice way to force
+     * a little-endian store for aarch64_be-linux-user out of line.
+     *
+     * Attempt to keep code expansion to a minimum by limiting the
+     * amount of unrolling done.
+     */
+    if (nparts <= 4) {
+        int i;
+
+        for (i = 0; i < len_align; i += 8) {
+            tcg_gen_ld_i64(t0, cpu_env, vofs + i);
+            tcg_gen_addi_i64(addr, cpu_reg_sp(s, rn), imm + i);
+            tcg_gen_qemu_st_i64(t0, addr, midx, MO_LEQ);
+        }
+    } else {
+        TCGLabel *loop = gen_new_label();
+        TCGv_ptr t2, i = tcg_const_local_ptr(0);
+
+        gen_set_label(loop);
+
+        t2 = tcg_temp_new_ptr();
+        tcg_gen_add_ptr(t2, cpu_env, i);
+        tcg_gen_ld_i64(t0, t2, vofs);
+
+        /* Minimize the number of local temps that must be re-read from
+         * the stack each iteration.  Instead, re-compute values other
+         * than the loop counter.
+         */
+        tcg_gen_addi_ptr(t2, i, imm);
+        tcg_gen_extu_ptr_i64(addr, t2);
+        tcg_gen_add_i64(addr, addr, cpu_reg_sp(s, rn));
+        tcg_temp_free_ptr(t2);
+
+        tcg_gen_qemu_st_i64(t0, addr, midx, MO_LEQ);
+
+        tcg_gen_addi_ptr(i, i, 8);
+
+        tcg_gen_brcondi_ptr(TCG_COND_LTU, i, len_align, loop);
+        tcg_temp_free_ptr(i);
+    }
+
+    /* Predicate register stores can be any multiple of 2.  */
+    if (len_remain) {
+        tcg_gen_ld_i64(t0, cpu_env, vofs + len_align);
+        tcg_gen_addi_i64(addr, cpu_reg_sp(s, rn), imm + len_align);
+
+        switch (len_remain) {
+        case 2:
+        case 4:
+        case 8:
+            tcg_gen_qemu_st_i64(t0, addr, midx, MO_LE | ctz32(len_remain));
+            break;
+
+        case 6:
+            tcg_gen_qemu_st_i64(t0, addr, midx, MO_LEUL);
+            tcg_gen_addi_i64(addr, addr, 4);
+            tcg_gen_shri_i64(t0, t0, 32);
+            tcg_gen_qemu_st_i64(t0, addr, midx, MO_LEUW);
+            break;
+
+        default:
+            g_assert_not_reached();
+        }
+    }
+    tcg_temp_free_i64(addr);
+    tcg_temp_free_i64(t0);
+}
+
 static bool trans_LDR_zri(DisasContext *s, arg_rri *a, uint32_t insn)
 {
     if (sve_access_check(s)) {
@@ -XXX,XX +XXX,XX @@ static bool trans_LDR_pri(DisasContext *s, arg_rri *a, uint32_t insn)
     return true;
 }
 
+static bool trans_STR_zri(DisasContext *s, arg_rri *a, uint32_t insn)
+{
+    if (sve_access_check(s)) {
+        int size = vec_full_reg_size(s);
+        int off = vec_full_reg_offset(s, a->rd);
+        do_str(s, off, size, a->rn, a->imm * size);
+    }
+    return true;
+}
+
+static bool trans_STR_pri(DisasContext *s, arg_rri *a, uint32_t insn)
+{
+    if (sve_access_check(s)) {
+        int size = pred_full_reg_size(s);
+        int off = pred_full_reg_offset(s, a->rd);
+        do_str(s, off, size, a->rn, a->imm * size);
+    }
+    return true;
+}
+
 /*
  *** SVE Memory - Contiguous Load Group
  */
diff --git a/target/arm/sve.decode b/target/arm/sve.decode
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve.decode
+++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@ LD1RQ_zpri      1010010 .. 00 0.... 001 ... ..... ..... \
 
 ### SVE Memory Store Group
 
+# SVE store predicate register
+STR_pri         1110010 11 0.     ..... 000 ... ..... 0 ....    @pd_rn_i9
+
+# SVE store vector register
+STR_zri         1110010 11 0.     ..... 010 ... ..... .....     @rd_rn_i9
+
 # SVE contiguous store (scalar plus immediate)
 # ST1B, ST1H, ST1W, ST1D; require msz <= esz
 ST_zpri         1110010 .. esz:2  0.... 111 ... ..... ..... \
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-12-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    | 41 +++++++++++++++++++++
 target/arm/sve_helper.c    | 61 +++++++++++++++++++++++++++++++
 target/arm/translate-sve.c | 75 ++++++++++++++++++++++++++++++++++++++
 target/arm/sve.decode      | 39 ++++++++++++++++++++
 4 files changed, 216 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-13-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 21 +++++++++++++++++++++
 target/arm/sve.decode      | 23 +++++++++++++++++++++++
 2 files changed, 44 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Alex Bennée <alex.bennee@linaro.org>
Message-id: 20180627043328.11531-14-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    |  67 +++++++++++++++++++++++++
 target/arm/sve_helper.c    |  77 ++++++++++++++++++++++++++++
 target/arm/translate-sve.c | 100 +++++++++++++++++++++++++++++++++++++
 target/arm/sve.decode      |  57 +++++++++++++++++++++
 4 files changed, 301 insertions(+)

diff --git a/target/arm/helper-sve.h b/target/arm/helper-sve.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper-sve.h
+++ b/target/arm/helper-sve.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_4(sve_st1hd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 
 DEF_HELPER_FLAGS_4(sve_st1sd_r, TCG_CALL_NO_WG, void, env, ptr, tl, i32)
 
+DEF_HELPER_FLAGS_6(sve_ldbsu_zsu, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhsu_zsu, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldssu_zsu, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldbss_zsu, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhss_zsu, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_6(sve_ldbsu_zss, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhsu_zss, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldssu_zss, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldbss_zss, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhss_zss, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_6(sve_ldbdu_zsu, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhdu_zsu, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsdu_zsu, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldddu_zsu, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldbds_zsu, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhds_zsu, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsds_zsu, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_6(sve_ldbdu_zss, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhdu_zss, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsdu_zss, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldddu_zss, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldbds_zss, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhds_zss, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsds_zss, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
+DEF_HELPER_FLAGS_6(sve_ldbdu_zd, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhdu_zd, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsdu_zd, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldddu_zd, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldbds_zd, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldhds_zd, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+DEF_HELPER_FLAGS_6(sve_ldsds_zd, TCG_CALL_NO_WG,
+                   void, env, ptr, ptr, ptr, tl, i32)
+
 DEF_HELPER_FLAGS_6(sve_stbs_zsu, TCG_CALL_NO_WG,
                    void, env, ptr, ptr, ptr, tl, i32)
 DEF_HELPER_FLAGS_6(sve_sths_zsu, TCG_CALL_NO_WG,
diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve_helper.c
+++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(sve_st4dd_r)(CPUARMState *env, void *vg,
     }
 }
 
+/* Loads with a vector index.  */
+
+#define DO_LD1_ZPZ_S(NAME, TYPEI, TYPEM, FN)                            \
+void HELPER(NAME)(CPUARMState *env, void *vd, void *vg, void *vm,       \
+                  target_ulong base, uint32_t desc)                     \
+{                                                                       \
+    intptr_t i, oprsz = simd_oprsz(desc);                               \
+    unsigned scale = simd_data(desc);                                   \
+    uintptr_t ra = GETPC();                                             \
+    for (i = 0; i < oprsz; i++) {                                       \
+        uint16_t pg = *(uint16_t *)(vg + H1_2(i >> 3));                 \
+        do {                                                            \
+            TYPEM m = 0;                                                \
+            if (pg & 1) {                                               \
+                target_ulong off = *(TYPEI *)(vm + H1_4(i));            \
+                m = FN(env, base + (off << scale), ra);                 \
+            }                                                           \
+            *(uint32_t *)(vd + H1_4(i)) = m;                            \
+            i += 4, pg >>= 4;                                           \
+        } while (i & 15);                                               \
+    }                                                                   \
+}
+
+#define DO_LD1_ZPZ_D(NAME, TYPEI, TYPEM, FN)                            \
+void HELPER(NAME)(CPUARMState *env, void *vd, void *vg, void *vm,       \
+                  target_ulong base, uint32_t desc)                     \
+{                                                                       \
+    intptr_t i, oprsz = simd_oprsz(desc) / 8;                           \
+    unsigned scale = simd_data(desc);                                   \
+    uintptr_t ra = GETPC();                                             \
+    uint64_t *d = vd, *m = vm; uint8_t *pg = vg;                        \
+    for (i = 0; i < oprsz; i++) {                                       \
+        TYPEM mm = 0;                                                   \
+        if (pg[H1(i)] & 1) {                                            \
+            target_ulong off = (TYPEI)m[i];                             \
+            mm = FN(env, base + (off << scale), ra);                    \
+        }                                                               \
+        d[i] = mm;                                                      \
+    }                                                                   \
+}
+
+DO_LD1_ZPZ_S(sve_ldbsu_zsu, uint32_t, uint8_t,  cpu_ldub_data_ra)
+DO_LD1_ZPZ_S(sve_ldhsu_zsu, uint32_t, uint16_t, cpu_lduw_data_ra)
+DO_LD1_ZPZ_S(sve_ldssu_zsu, uint32_t, uint32_t, cpu_ldl_data_ra)
+DO_LD1_ZPZ_S(sve_ldbss_zsu, uint32_t, int8_t,   cpu_ldub_data_ra)
+DO_LD1_ZPZ_S(sve_ldhss_zsu, uint32_t, int16_t,  cpu_lduw_data_ra)
+
+DO_LD1_ZPZ_S(sve_ldbsu_zss, int32_t, uint8_t,  cpu_ldub_data_ra)
+DO_LD1_ZPZ_S(sve_ldhsu_zss, int32_t, uint16_t, cpu_lduw_data_ra)
+DO_LD1_ZPZ_S(sve_ldssu_zss, int32_t, uint32_t, cpu_ldl_data_ra)
+DO_LD1_ZPZ_S(sve_ldbss_zss, int32_t, int8_t,   cpu_ldub_data_ra)
+DO_LD1_ZPZ_S(sve_ldhss_zss, int32_t, int16_t,  cpu_lduw_data_ra)
+
+DO_LD1_ZPZ_D(sve_ldbdu_zsu, uint32_t, uint8_t,  cpu_ldub_data_ra)
+DO_LD1_ZPZ_D(sve_ldhdu_zsu, uint32_t, uint16_t, cpu_lduw_data_ra)
+DO_LD1_ZPZ_D(sve_ldsdu_zsu, uint32_t, uint32_t, cpu_ldl_data_ra)
+DO_LD1_ZPZ_D(sve_ldddu_zsu, uint32_t, uint64_t, cpu_ldq_data_ra)
+DO_LD1_ZPZ_D(sve_ldbds_zsu, uint32_t, int8_t,   cpu_ldub_data_ra)
+DO_LD1_ZPZ_D(sve_ldhds_zsu, uint32_t, int16_t,  cpu_lduw_data_ra)
+DO_LD1_ZPZ_D(sve_ldsds_zsu, uint32_t, int32_t,  cpu_ldl_data_ra)
+
+DO_LD1_ZPZ_D(sve_ldbdu_zss, int32_t, uint8_t,  cpu_ldub_data_ra)
+DO_LD1_ZPZ_D(sve_ldhdu_zss, int32_t, uint16_t, cpu_lduw_data_ra)
+DO_LD1_ZPZ_D(sve_ldsdu_zss, int32_t, uint32_t, cpu_ldl_data_ra)
+DO_LD1_ZPZ_D(sve_ldddu_zss, int32_t, uint64_t, cpu_ldq_data_ra)
+DO_LD1_ZPZ_D(sve_ldbds_zss, int32_t, int8_t,   cpu_ldub_data_ra)
+DO_LD1_ZPZ_D(sve_ldhds_zss, int32_t, int16_t,  cpu_lduw_data_ra)
+DO_LD1_ZPZ_D(sve_ldsds_zss, int32_t, int32_t,  cpu_ldl_data_ra)
+
+DO_LD1_ZPZ_D(sve_ldbdu_zd, uint64_t, uint8_t,  cpu_ldub_data_ra)
+DO_LD1_ZPZ_D(sve_ldhdu_zd, uint64_t, uint16_t, cpu_lduw_data_ra)
+DO_LD1_ZPZ_D(sve_ldsdu_zd, uint64_t, uint32_t, cpu_ldl_data_ra)
+DO_LD1_ZPZ_D(sve_ldddu_zd, uint64_t, uint64_t, cpu_ldq_data_ra)
+DO_LD1_ZPZ_D(sve_ldbds_zd, uint64_t, int8_t,   cpu_ldub_data_ra)
+DO_LD1_ZPZ_D(sve_ldhds_zd, uint64_t, int16_t,  cpu_lduw_data_ra)
+DO_LD1_ZPZ_D(sve_ldsds_zd, uint64_t, int32_t,  cpu_ldl_data_ra)
+
 /* Stores with a vector index.  */
 
 #define DO_ST1_ZPZ_S(NAME, TYPEI, FN)                                   \
diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static void do_mem_zpz(DisasContext *s, int zt, int pg, int zm, int scale,
     tcg_temp_free_i32(desc);
 }
 
+/* Indexed by [ff][xs][u][msz].  */
+static gen_helper_gvec_mem_scatter * const gather_load_fn32[2][2][2][3] = {
+    { { { gen_helper_sve_ldbss_zsu,
+          gen_helper_sve_ldhss_zsu,
+          NULL, },
+        { gen_helper_sve_ldbsu_zsu,
+          gen_helper_sve_ldhsu_zsu,
+          gen_helper_sve_ldssu_zsu, } },
+      { { gen_helper_sve_ldbss_zss,
+          gen_helper_sve_ldhss_zss,
+          NULL, },
+        { gen_helper_sve_ldbsu_zss,
+          gen_helper_sve_ldhsu_zss,
+          gen_helper_sve_ldssu_zss, } } },
+    /* TODO fill in first-fault handlers */
+};
+
+/* Note that we overload xs=2 to indicate 64-bit offset.  */
+static gen_helper_gvec_mem_scatter * const gather_load_fn64[2][3][2][4] = {
+    { { { gen_helper_sve_ldbds_zsu,
+          gen_helper_sve_ldhds_zsu,
+          gen_helper_sve_ldsds_zsu,
+          NULL, },
+        { gen_helper_sve_ldbdu_zsu,
+          gen_helper_sve_ldhdu_zsu,
+          gen_helper_sve_ldsdu_zsu,
+          gen_helper_sve_ldddu_zsu, } },
+      { { gen_helper_sve_ldbds_zss,
+          gen_helper_sve_ldhds_zss,
+          gen_helper_sve_ldsds_zss,
+          NULL, },
+        { gen_helper_sve_ldbdu_zss,
+          gen_helper_sve_ldhdu_zss,
+          gen_helper_sve_ldsdu_zss,
+          gen_helper_sve_ldddu_zss, } },
+      { { gen_helper_sve_ldbds_zd,
+          gen_helper_sve_ldhds_zd,
+          gen_helper_sve_ldsds_zd,
+          NULL, },
+        { gen_helper_sve_ldbdu_zd,
+          gen_helper_sve_ldhdu_zd,
+          gen_helper_sve_ldsdu_zd,
+          gen_helper_sve_ldddu_zd, } } },
+    /* TODO fill in first-fault handlers */
+};
+
+static bool trans_LD1_zprz(DisasContext *s, arg_LD1_zprz *a, uint32_t insn)
+{
+    gen_helper_gvec_mem_scatter *fn = NULL;
+
+    if (!sve_access_check(s)) {
+        return true;
+    }
+
+    switch (a->esz) {
+    case MO_32:
+        fn = gather_load_fn32[a->ff][a->xs][a->u][a->msz];
+        break;
+    case MO_64:
+        fn = gather_load_fn64[a->ff][a->xs][a->u][a->msz];
+        break;
+    }
+    assert(fn != NULL);
+
+    do_mem_zpz(s, a->rd, a->pg, a->rm, a->scale * a->msz,
+               cpu_reg_sp(s, a->rn), fn);
+    return true;
+}
+
+static bool trans_LD1_zpiz(DisasContext *s, arg_LD1_zpiz *a, uint32_t insn)
+{
+    gen_helper_gvec_mem_scatter *fn = NULL;
+    TCGv_i64 imm;
+
+    if (a->esz < a->msz || (a->esz == a->msz && !a->u)) {
+        return false;
+    }
+    if (!sve_access_check(s)) {
+        return true;
+    }
+
+    switch (a->esz) {
+    case MO_32:
+        fn = gather_load_fn32[a->ff][0][a->u][a->msz];
+        break;
+    case MO_64:
+        fn = gather_load_fn64[a->ff][2][a->u][a->msz];
+        break;
+    }
+    assert(fn != NULL);
+
+    /* Treat LD1_zpiz (zn[x] + imm) the same way as LD1_zprz (rn + zm[x])
+     * by loading the immediate into the scalar parameter.
+     */
+    imm = tcg_const_i64(a->imm << a->msz);
+    do_mem_zpz(s, a->rd, a->pg, a->rn, 0, imm, fn);
+    tcg_temp_free_i64(imm);
+    return true;
+}
+
 static bool trans_ST1_zprz(DisasContext *s, arg_ST1_zprz *a, uint32_t insn)
 {
     /* Indexed by [xs][msz].  */
diff --git a/target/arm/sve.decode b/target/arm/sve.decode
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve.decode
+++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@
 &rpri_load      rd pg rn imm dtype nreg
 &rprr_store     rd pg rn rm msz esz nreg
 &rpri_store     rd pg rn imm msz esz nreg
+&rprr_gather_load       rd pg rn rm esz msz u ff xs scale
+&rpri_gather_load       rd pg rn imm esz msz u ff
 &rprr_scatter_store     rd pg rn rm esz msz xs scale
 
 ###########################################################################
@@ -XXX,XX +XXX,XX @@
 @rpri_load_msz  ....... .... . imm:s4 ... pg:3 rn:5 rd:5 \
                 &rpri_load dtype=%msz_dtype
 
+# Gather Loads.
+@rprr_g_load_u        ....... .. .    . rm:5 . u:1 ff:1 pg:3 rn:5 rd:5 \
+                      &rprr_gather_load xs=2
+@rprr_g_load_xs_u     ....... .. xs:1 . rm:5 . u:1 ff:1 pg:3 rn:5 rd:5 \
+                      &rprr_gather_load
+@rprr_g_load_xs_u_sc  ....... .. xs:1 scale:1 rm:5 . u:1 ff:1 pg:3 rn:5 rd:5 \
+                      &rprr_gather_load
+@rprr_g_load_xs_sc    ....... .. xs:1 scale:1 rm:5 . . ff:1 pg:3 rn:5 rd:5 \
+                      &rprr_gather_load
+@rprr_g_load_u_sc     ....... .. .    scale:1 rm:5 . u:1 ff:1 pg:3 rn:5 rd:5 \
+                      &rprr_gather_load xs=2
+@rprr_g_load_sc       ....... .. .    scale:1 rm:5 . . ff:1 pg:3 rn:5 rd:5 \
+                      &rprr_gather_load xs=2
+@rpri_g_load          ....... msz:2 .. imm:5 . u:1 ff:1 pg:3 rn:5 rd:5 \
+                      &rpri_gather_load
+
 # Stores; user must fill in ESZ, MSZ, NREG as needed.
 @rprr_store         ....... ..    ..     rm:5 ... pg:3 rn:5 rd:5    &rprr_store
 @rpri_store_msz     ....... msz:2 .. . imm:s4 ... pg:3 rn:5 rd:5    &rpri_store
@@ -XXX,XX +XXX,XX @@ LDR_zri         10000101 10 ...... 010 ... ..... .....          @rd_rn_i9
 LD1R_zpri       1000010 .. 1 imm:6 1.. pg:3 rn:5 rd:5 \
                 &rpri_load dtype=%dtype_23_13 nreg=0
 
+# SVE 32-bit gather load (scalar plus 32-bit unscaled offsets)
+# SVE 32-bit gather load (scalar plus 32-bit scaled offsets)
+LD1_zprz        1000010 00 .0 ..... 0.. ... ..... ..... \
+                @rprr_g_load_xs_u esz=2 msz=0 scale=0
+LD1_zprz        1000010 01 .. ..... 0.. ... ..... ..... \
+                @rprr_g_load_xs_u_sc esz=2 msz=1
+LD1_zprz        1000010 10 .. ..... 01. ... ..... ..... \
+                @rprr_g_load_xs_sc esz=2 msz=2 u=1
+
+# SVE 32-bit gather load (vector plus immediate)
+LD1_zpiz        1000010 .. 01 ..... 1.. ... ..... ..... \
+                @rpri_g_load esz=2
+
 ### SVE Memory Contiguous Load Group
 
 # SVE contiguous load (scalar plus scalar)
@@ -XXX,XX +XXX,XX @@ PRF_rr          1000010 -- 00 rm:5 110 --- ----- 0 ----
 
 ### SVE Memory 64-bit Gather Group
 
+# SVE 64-bit gather load (scalar plus 32-bit unpacked unscaled offsets)
+# SVE 64-bit gather load (scalar plus 32-bit unpacked scaled offsets)
+LD1_zprz        1100010 00 .0 ..... 0.. ... ..... ..... \
+                @rprr_g_load_xs_u esz=3 msz=0 scale=0
+LD1_zprz        1100010 01 .. ..... 0.. ... ..... ..... \
+                @rprr_g_load_xs_u_sc esz=3 msz=1
+LD1_zprz        1100010 10 .. ..... 0.. ... ..... ..... \
+                @rprr_g_load_xs_u_sc esz=3 msz=2
+LD1_zprz        1100010 11 .. ..... 01. ... ..... ..... \
+                @rprr_g_load_xs_sc esz=3 msz=3 u=1
+
+# SVE 64-bit gather load (scalar plus 64-bit unscaled offsets)
+# SVE 64-bit gather load (scalar plus 64-bit scaled offsets)
+LD1_zprz        1100010 00 10 ..... 1.. ... ..... ..... \
+                @rprr_g_load_u esz=3 msz=0 scale=0
+LD1_zprz        1100010 01 1. ..... 1.. ... ..... ..... \
+                @rprr_g_load_u_sc esz=3 msz=1
+LD1_zprz        1100010 10 1. ..... 1.. ... ..... ..... \
+                @rprr_g_load_u_sc esz=3 msz=2
+LD1_zprz        1100010 11 1. ..... 11. ... ..... ..... \
+                @rprr_g_load_sc esz=3 msz=3 u=1
+
+# SVE 64-bit gather load (vector plus immediate)
+LD1_zpiz        1100010 .. 01 ..... 1.. ... ..... ..... \
+                @rpri_g_load esz=3
+
 # SVE 64-bit gather prefetch (scalar plus 64-bit scaled offsets)
 PRF             1100010 00 11 ----- 1-- --- ----- 0 ----
 
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-15-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    | 67 +++++++++++++++++++++++++++++
 target/arm/sve_helper.c    | 88 ++++++++++++++++++++++++++++++++++++++
 target/arm/translate-sve.c | 40 ++++++++++++++++-
 3 files changed, 193 insertions(+), 2 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-16-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 85 ++++++++++++++++++++++++++------------
 target/arm/sve.decode      | 11 +++++
 2 files changed, 70 insertions(+), 26 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_LD1_zpiz(DisasContext *s, arg_LD1_zpiz *a, uint32_t insn)
     return true;
 }
 
+/* Indexed by [xs][msz].  */
+static gen_helper_gvec_mem_scatter * const scatter_store_fn32[2][3] = {
+    { gen_helper_sve_stbs_zsu,
+      gen_helper_sve_sths_zsu,
+      gen_helper_sve_stss_zsu, },
+    { gen_helper_sve_stbs_zss,
+      gen_helper_sve_sths_zss,
+      gen_helper_sve_stss_zss, },
+};
+
+/* Note that we overload xs=2 to indicate 64-bit offset.  */
+static gen_helper_gvec_mem_scatter * const scatter_store_fn64[3][4] = {
+    { gen_helper_sve_stbd_zsu,
+      gen_helper_sve_sthd_zsu,
+      gen_helper_sve_stsd_zsu,
+      gen_helper_sve_stdd_zsu, },
+    { gen_helper_sve_stbd_zss,
+      gen_helper_sve_sthd_zss,
+      gen_helper_sve_stsd_zss,
+      gen_helper_sve_stdd_zss, },
+    { gen_helper_sve_stbd_zd,
+      gen_helper_sve_sthd_zd,
+      gen_helper_sve_stsd_zd,
+      gen_helper_sve_stdd_zd, },
+};
+
 static bool trans_ST1_zprz(DisasContext *s, arg_ST1_zprz *a, uint32_t insn)
 {
-    /* Indexed by [xs][msz].  */
-    static gen_helper_gvec_mem_scatter * const fn32[2][3] = {
-        { gen_helper_sve_stbs_zsu,
-          gen_helper_sve_sths_zsu,
-          gen_helper_sve_stss_zsu, },
-        { gen_helper_sve_stbs_zss,
-          gen_helper_sve_sths_zss,
-          gen_helper_sve_stss_zss, },
-    };
-    /* Note that we overload xs=2 to indicate 64-bit offset.  */
-    static gen_helper_gvec_mem_scatter * const fn64[3][4] = {
-        { gen_helper_sve_stbd_zsu,
-          gen_helper_sve_sthd_zsu,
-          gen_helper_sve_stsd_zsu,
-          gen_helper_sve_stdd_zsu, },
-        { gen_helper_sve_stbd_zss,
-          gen_helper_sve_sthd_zss,
-          gen_helper_sve_stsd_zss,
-          gen_helper_sve_stdd_zss, },
-        { gen_helper_sve_stbd_zd,
-          gen_helper_sve_sthd_zd,
-          gen_helper_sve_stsd_zd,
-          gen_helper_sve_stdd_zd, },
-    };
     gen_helper_gvec_mem_scatter *fn;
 
     if (a->esz < a->msz || (a->msz == 0 && a->scale)) {
@@ -XXX,XX +XXX,XX @@ static bool trans_ST1_zprz(DisasContext *s, arg_ST1_zprz *a, uint32_t insn)
     }
     switch (a->esz) {
     case MO_32:
-        fn = fn32[a->xs][a->msz];
+        fn = scatter_store_fn32[a->xs][a->msz];
         break;
     case MO_64:
-        fn = fn64[a->xs][a->msz];
+        fn = scatter_store_fn64[a->xs][a->msz];
         break;
     default:
         g_assert_not_reached();
@@ -XXX,XX +XXX,XX @@ static bool trans_ST1_zprz(DisasContext *s, arg_ST1_zprz *a, uint32_t insn)
     return true;
 }
 
+static bool trans_ST1_zpiz(DisasContext *s, arg_ST1_zpiz *a, uint32_t insn)
+{
+    gen_helper_gvec_mem_scatter *fn = NULL;
+    TCGv_i64 imm;
+
+    if (a->esz < a->msz) {
+        return false;
+    }
+    if (!sve_access_check(s)) {
+        return true;
+    }
+
+    switch (a->esz) {
+    case MO_32:
+        fn = scatter_store_fn32[0][a->msz];
+        break;
+    case MO_64:
+        fn = scatter_store_fn64[2][a->msz];
+        break;
+    }
+    assert(fn != NULL);
+
+    /* Treat ST1_zpiz (zn[x] + imm) the same way as ST1_zprz (rn + zm[x])
+     * by loading the immediate into the scalar parameter.
+     */
+    imm = tcg_const_i64(a->imm << a->msz);
+    do_mem_zpz(s, a->rd, a->pg, a->rn, 0, imm, fn);
+    tcg_temp_free_i64(imm);
+    return true;
+}
+
 /*
  * Prefetches
  */
diff --git a/target/arm/sve.decode b/target/arm/sve.decode
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve.decode
+++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@
 &rprr_gather_load       rd pg rn rm esz msz u ff xs scale
 &rpri_gather_load       rd pg rn imm esz msz u ff
 &rprr_scatter_store     rd pg rn rm esz msz xs scale
+&rpri_scatter_store     rd pg rn imm esz msz
 
 ###########################################################################
 # Named instruction formats.  These are generally used to
@@ -XXX,XX +XXX,XX @@
                     &rprr_store nreg=0
 @rprr_scatter_store ....... msz:2 ..     rm:5 ... pg:3 rn:5 rd:5 \
                     &rprr_scatter_store
+@rpri_scatter_store ....... msz:2 ..    imm:5 ... pg:3 rn:5 rd:5 \
+                    &rpri_scatter_store
 
 ###########################################################################
 # Instruction patterns.  Grouped according to the SVE encodingindex.xhtml.
@@ -XXX,XX +XXX,XX @@ ST1_zprz        1110010 .. 01 ..... 101 ... ..... ..... \
 ST1_zprz        1110010 .. 00 ..... 101 ... ..... ..... \
                 @rprr_scatter_store xs=2 esz=3 scale=0
 
+# SVE 64-bit scatter store (vector plus immediate)
+ST1_zpiz        1110010 .. 10 ..... 101 ... ..... ..... \
+                @rpri_scatter_store esz=3
+
+# SVE 32-bit scatter store (vector plus immediate)
+ST1_zpiz        1110010 .. 11 ..... 101 ... ..... ..... \
+                @rpri_scatter_store esz=2
+
 # SVE 64-bit scatter store (scalar plus unpacked 32-bit scaled offset)
 # Require msz > 0
 ST1_zprz        1110010 .. 01 ..... 100 ... ..... ..... \
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-17-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    | 49 ++++++++++++++++++++++++++++++
 target/arm/sve_helper.c    | 62 ++++++++++++++++++++++++++++++++++++++
 target/arm/translate-sve.c | 40 ++++++++++++++++++++++++
 target/arm/sve.decode      | 11 +++++++
 4 files changed, 162 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-18-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    | 56 ++++++++++++++++++++++++++++
 target/arm/sve_helper.c    | 69 +++++++++++++++++++++++++++++++++++
 target/arm/translate-sve.c | 75 ++++++++++++++++++++++++++++++++++++++
 target/arm/sve.decode      | 14 +++++++
 4 files changed, 214 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-19-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper.h        | 14 +++++++++++
 target/arm/translate-sve.c | 50 ++++++++++++++++++++++++++++++++++++++
 target/arm/vec_helper.c    | 48 ++++++++++++++++++++++++++++++++++++
 target/arm/sve.decode      | 19 +++++++++++++++
 4 files changed, 131 insertions(+)

diff --git a/target/arm/helper.h b/target/arm/helper.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.h
+++ b/target/arm/helper.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_5(gvec_ftsmul_s, TCG_CALL_NO_RWG,
 DEF_HELPER_FLAGS_5(gvec_ftsmul_d, TCG_CALL_NO_RWG,
                    void, ptr, ptr, ptr, ptr, i32)
 
+DEF_HELPER_FLAGS_5(gvec_fmul_idx_h, TCG_CALL_NO_RWG,
+                   void, ptr, ptr, ptr, ptr, i32)
+DEF_HELPER_FLAGS_5(gvec_fmul_idx_s, TCG_CALL_NO_RWG,
+                   void, ptr, ptr, ptr, ptr, i32)
+DEF_HELPER_FLAGS_5(gvec_fmul_idx_d, TCG_CALL_NO_RWG,
+                   void, ptr, ptr, ptr, ptr, i32)
+
+DEF_HELPER_FLAGS_6(gvec_fmla_idx_h, TCG_CALL_NO_RWG,
+                   void, ptr, ptr, ptr, ptr, ptr, i32)
+DEF_HELPER_FLAGS_6(gvec_fmla_idx_s, TCG_CALL_NO_RWG,
+                   void, ptr, ptr, ptr, ptr, ptr, i32)
+DEF_HELPER_FLAGS_6(gvec_fmla_idx_d, TCG_CALL_NO_RWG,
+                   void, ptr, ptr, ptr, ptr, ptr, i32)
+
 #ifdef TARGET_AARCH64
 #include "helper-a64.h"
 #include "helper-sve.h"
diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ DO_ZZI(UMIN, umin)
 
 #undef DO_ZZI
 
+/*
+ *** SVE Floating Point Multiply-Add Indexed Group
+ */
+
+static bool trans_FMLA_zzxz(DisasContext *s, arg_FMLA_zzxz *a, uint32_t insn)
+{
+    static gen_helper_gvec_4_ptr * const fns[3] = {
+        gen_helper_gvec_fmla_idx_h,
+        gen_helper_gvec_fmla_idx_s,
+        gen_helper_gvec_fmla_idx_d,
+    };
+
+    if (sve_access_check(s)) {
+        unsigned vsz = vec_full_reg_size(s);
+        TCGv_ptr status = get_fpstatus_ptr(a->esz == MO_16);
+        tcg_gen_gvec_4_ptr(vec_full_reg_offset(s, a->rd),
+                           vec_full_reg_offset(s, a->rn),
+                           vec_full_reg_offset(s, a->rm),
+                           vec_full_reg_offset(s, a->ra),
+                           status, vsz, vsz, (a->index << 1) | a->sub,
+                           fns[a->esz - 1]);
+        tcg_temp_free_ptr(status);
+    }
+    return true;
+}
+
+/*
+ *** SVE Floating Point Multiply Indexed Group
+ */
+
+static bool trans_FMUL_zzx(DisasContext *s, arg_FMUL_zzx *a, uint32_t insn)
+{
+    static gen_helper_gvec_3_ptr * const fns[3] = {
+        gen_helper_gvec_fmul_idx_h,
+        gen_helper_gvec_fmul_idx_s,
+        gen_helper_gvec_fmul_idx_d,
+    };
+
+    if (sve_access_check(s)) {
+        unsigned vsz = vec_full_reg_size(s);
+        TCGv_ptr status = get_fpstatus_ptr(a->esz == MO_16);
+        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, a->rd),
+                           vec_full_reg_offset(s, a->rn),
+                           vec_full_reg_offset(s, a->rm),
+                           status, vsz, vsz, a->index, fns[a->esz - 1]);
+        tcg_temp_free_ptr(status);
+    }
+    return true;
+}
+
 /*
  *** SVE Floating Point Accumulating Reduction Group
  */
diff --git a/target/arm/vec_helper.c b/target/arm/vec_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/vec_helper.c
+++ b/target/arm/vec_helper.c
@@ -XXX,XX +XXX,XX @@ DO_3OP(gvec_rsqrts_d, helper_rsqrtsf_f64, float64)
 
 #endif
 #undef DO_3OP
+
+/* For the indexed ops, SVE applies the index per 128-bit vector segment.
+ * For AdvSIMD, there is of course only one such vector segment.
+ */
+
+#define DO_MUL_IDX(NAME, TYPE, H) \
+void HELPER(NAME)(void *vd, void *vn, void *vm, void *stat, uint32_t desc) \
+{                                                                          \
+    intptr_t i, j, oprsz = simd_oprsz(desc), segment = 16 / sizeof(TYPE);  \
+    intptr_t idx = simd_data(desc);                                        \
+    TYPE *d = vd, *n = vn, *m = vm;                                        \
+    for (i = 0; i < oprsz / sizeof(TYPE); i += segment) {                  \
+        TYPE mm = m[H(i + idx)];                                           \
+        for (j = 0; j < segment; j++) {                                    \
+            d[i + j] = TYPE##_mul(n[i + j], mm, stat);                     \
+        }                                                                  \
+    }                                                                      \
+}
+
+DO_MUL_IDX(gvec_fmul_idx_h, float16, H2)
+DO_MUL_IDX(gvec_fmul_idx_s, float32, H4)
+DO_MUL_IDX(gvec_fmul_idx_d, float64, )
+
+#undef DO_MUL_IDX
+
+#define DO_FMLA_IDX(NAME, TYPE, H)                                         \
+void HELPER(NAME)(void *vd, void *vn, void *vm, void *va,                  \
+                  void *stat, uint32_t desc)                               \
+{                                                                          \
+    intptr_t i, j, oprsz = simd_oprsz(desc), segment = 16 / sizeof(TYPE);  \
+    TYPE op1_neg = extract32(desc, SIMD_DATA_SHIFT, 1);                    \
+    intptr_t idx = desc >> (SIMD_DATA_SHIFT + 1);                          \
+    TYPE *d = vd, *n = vn, *m = vm, *a = va;                               \
+    op1_neg <<= (8 * sizeof(TYPE) - 1);                                    \
+    for (i = 0; i < oprsz / sizeof(TYPE); i += segment) {                  \
+        TYPE mm = m[H(i + idx)];                                           \
+        for (j = 0; j < segment; j++) {                                    \
+            d[i + j] = TYPE##_muladd(n[i + j] ^ op1_neg,                   \
+                                     mm, a[i + j], 0, stat);               \
+        }                                                                  \
+    }                                                                      \
+}
+
+DO_FMLA_IDX(gvec_fmla_idx_h, float16, H2)
+DO_FMLA_IDX(gvec_fmla_idx_s, float32, H4)
+DO_FMLA_IDX(gvec_fmla_idx_d, float64, )
+
+#undef DO_FMLA_IDX
diff --git a/target/arm/sve.decode b/target/arm/sve.decode
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve.decode
+++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@
 %imm9_16_10     16:s6 10:3
 %size_23        23:2
 %dtype_23_13    23:2 13:2
+%index3_22_19   22:1 19:2
 
 # A combination of tsz:imm3 -- extract esize.
 %tszimm_esz     22:2 5:5 !function=tszimm_esz
@@ -XXX,XX +XXX,XX @@ UMIN_zzi        00100101 .. 101 011 110 ........ .....          @rdn_i8u
 # SVE integer multiply immediate (unpredicated)
 MUL_zzi         00100101 .. 110 000 110 ........ .....          @rdn_i8s
 
+### SVE FP Multiply-Add Indexed Group
+
+# SVE floating-point multiply-add (indexed)
+FMLA_zzxz       01100100 0.1 .. rm:3 00000 sub:1 rn:5 rd:5 \
+                ra=%reg_movprfx index=%index3_22_19 esz=1
+FMLA_zzxz       01100100 101 index:2 rm:3 00000 sub:1 rn:5 rd:5 \
+                ra=%reg_movprfx esz=2
+FMLA_zzxz       01100100 111 index:1 rm:4 00000 sub:1 rn:5 rd:5 \
+                ra=%reg_movprfx esz=3
+
+### SVE FP Multiply Indexed Group
+
+# SVE floating-point multiply (indexed)
+FMUL_zzx        01100100 0.1 .. rm:3 001000 rn:5 rd:5 \
+                index=%index3_22_19 esz=1
+FMUL_zzx        01100100 101 index:2 rm:3 001000 rn:5 rd:5      esz=2
+FMUL_zzx        01100100 111 index:1 rm:4 001000 rn:5 rd:5      esz=3
+
 ### SVE FP Accumulating Reduction Group
 
 # SVE floating-point serial reduction (predicated)
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-20-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    | 35 ++++++++++++++++++++++
 target/arm/sve_helper.c    | 61 ++++++++++++++++++++++++++++++++++++++
 target/arm/translate-sve.c | 57 +++++++++++++++++++++++++++++++++++
 target/arm/sve.decode      |  8 +++++
 4 files changed, 161 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-21-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper.h        |  8 +++++++
 target/arm/translate-sve.c | 47 ++++++++++++++++++++++++++++++++++++++
 target/arm/vec_helper.c    | 20 ++++++++++++++++
 target/arm/sve.decode      |  5 ++++
 4 files changed, 80 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-22-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    | 42 +++++++++++++++++++++++++++++++++++++
 target/arm/sve_helper.c    | 43 ++++++++++++++++++++++++++++++++++++++
 target/arm/translate-sve.c | 43 ++++++++++++++++++++++++++++++++++++++
 target/arm/sve.decode      | 10 +++++++++
 4 files changed, 138 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-23-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    |  4 +++
 target/arm/sve_helper.c    | 70 ++++++++++++++++++++++++++++++++++++++
 target/arm/translate-sve.c | 27 +++++++++++++++
 target/arm/sve.decode      |  3 ++
 4 files changed, 104 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-24-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    | 13 +++++++++
 target/arm/sve_helper.c    | 55 ++++++++++++++++++++++++++++++++++++++
 target/arm/translate-sve.c | 30 +++++++++++++++++++++
 target/arm/sve.decode      |  8 ++++++
 4 files changed, 106 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-25-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    | 30 +++++++++++++
 target/arm/helper.h        | 12 +++---
 target/arm/helper.c        |  2 +-
 target/arm/sve_helper.c    | 88 ++++++++++++++++++++++++++++++++++++++
 target/arm/translate-sve.c | 70 ++++++++++++++++++++++++++++++
 target/arm/sve.decode      | 16 +++++++
 6 files changed, 211 insertions(+), 7 deletions(-)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-26-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    | 14 +++++++
 target/arm/sve_helper.c    |  8 ++++
 target/arm/translate-sve.c | 77 ++++++++++++++++++++++++++++++++++++++
 target/arm/sve.decode      |  9 +++++
 4 files changed, 108 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-27-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    | 14 ++++++++++++++
 target/arm/sve_helper.c    |  8 ++++++++
 target/arm/translate-sve.c | 26 ++++++++++++++++++++++++++
 target/arm/sve.decode      |  4 ++++
 4 files changed, 52 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-28-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 60 +++++++++++++++++++++++++++++++++++++-
 target/arm/sve.decode      |  7 +++++
 2 files changed, 66 insertions(+), 1 deletion(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool do_zpzz_ool(DisasContext *s, arg_rprr_esz *a, gen_helper_gvec_4 *fn)
     return true;
 }
 
+/* Select active elememnts from Zn and inactive elements from Zm,
+ * storing the result in Zd.
+ */
+static void do_sel_z(DisasContext *s, int rd, int rn, int rm, int pg, int esz)
+{
+    static gen_helper_gvec_4 * const fns[4] = {
+        gen_helper_sve_sel_zpzz_b, gen_helper_sve_sel_zpzz_h,
+        gen_helper_sve_sel_zpzz_s, gen_helper_sve_sel_zpzz_d
+    };
+    unsigned vsz = vec_full_reg_size(s);
+    tcg_gen_gvec_4_ool(vec_full_reg_offset(s, rd),
+                       vec_full_reg_offset(s, rn),
+                       vec_full_reg_offset(s, rm),
+                       pred_full_reg_offset(s, pg),
+                       vsz, vsz, 0, fns[esz]);
+}
+
 #define DO_ZPZZ(NAME, name) \
 static bool trans_##NAME##_zpzz(DisasContext *s, arg_rprr_esz *a,         \
                                 uint32_t insn)                            \
@@ -XXX,XX +XXX,XX @@ static bool trans_UDIV_zpzz(DisasContext *s, arg_rprr_esz *a, uint32_t insn)
     return do_zpzz_ool(s, a, fns[a->esz]);
 }
 
-DO_ZPZZ(SEL, sel)
+static bool trans_SEL_zpzz(DisasContext *s, arg_rprr_esz *a, uint32_t insn)
+{
+    if (sve_access_check(s)) {
+        do_sel_z(s, a->rd, a->rn, a->rm, a->pg, a->esz);
+    }
+    return true;
+}
 
 #undef DO_ZPZZ
 
@@ -XXX,XX +XXX,XX @@ static bool trans_PRF_rr(DisasContext *s, arg_PRF_rr *a, uint32_t insn)
     sve_access_check(s);
     return true;
 }
+
+/*
+ * Move Prefix
+ *
+ * TODO: The implementation so far could handle predicated merging movprfx.
+ * The helper functions as written take an extra source register to
+ * use in the operation, but the result is only written when predication
+ * succeeds.  For unpredicated movprfx, we need to rearrange the helpers
+ * to allow the final write back to the destination to be unconditional.
+ * For predicated zeroing movprfx, we need to rearrange the helpers to
+ * allow the final write back to zero inactives.
+ *
+ * In the meantime, just emit the moves.
+ */
+
+static bool trans_MOVPRFX(DisasContext *s, arg_MOVPRFX *a, uint32_t insn)
+{
+    return do_mov_z(s, a->rd, a->rn);
+}
+
+static bool trans_MOVPRFX_m(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
+{
+    if (sve_access_check(s)) {
+        do_sel_z(s, a->rd, a->rn, a->rd, a->pg, a->esz);
+    }
+    return true;
+}
+
+static bool trans_MOVPRFX_z(DisasContext *s, arg_rpr_esz *a, uint32_t insn)
+{
+    if (sve_access_check(s)) {
+        do_movz_zpz(s, a->rd, a->rn, a->pg, a->esz);
+    }
+    return true;
+}
diff --git a/target/arm/sve.decode b/target/arm/sve.decode
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve.decode
+++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@ ORV             00000100 .. 011 000 001 ... ..... .....         @rd_pg_rn
 EORV            00000100 .. 011 001 001 ... ..... .....         @rd_pg_rn
 ANDV            00000100 .. 011 010 001 ... ..... .....         @rd_pg_rn
 
+# SVE constructive prefix (predicated)
+MOVPRFX_z       00000100 .. 010 000 001 ... ..... .....         @rd_pg_rn
+MOVPRFX_m       00000100 .. 010 001 001 ... ..... .....         @rd_pg_rn
+
 # SVE integer add reduction (predicated)
 # Note that saddv requires size != 3.
 UADDV           00000100 .. 000 001 001 ... ..... .....         @rd_pg_rn
@@ -XXX,XX +XXX,XX @@ ADR_p64         00000100 11 1 ..... 1010 .. ..... .....         @rd_rn_msz_rm
 
 ### SVE Integer Misc - Unpredicated Group
 
+# SVE constructive prefix (unpredicated)
+MOVPRFX         00000100 00 1 00000 101111 rn:5 rd:5
+
 # SVE floating-point exponential accelerator
 # Note esz != 0
 FEXPA           00000100 .. 1 00000 101110 ..... .....          @rd_rn
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-29-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    |   7 +++
 target/arm/sve_helper.c    | 100 +++++++++++++++++++++++++++++++++++++
 target/arm/translate-sve.c |  24 +++++++++
 target/arm/sve.decode      |   4 ++
 4 files changed, 135 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-30-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper-sve.h    |   4 +
 target/arm/sve_helper.c    | 162 +++++++++++++++++++++++++++++++++++++
 target/arm/translate-sve.c |  37 +++++++++
 target/arm/sve.decode      |   4 +
 4 files changed, 207 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

For aa64 advsimd, we had been passing the pre-indexed vector.
However, sve applies the index to each 128-bit segment, so we
need to pass in the index separately.

For aa32 advsimd, the fp32 operation always has index 0, but
we failed to interpret the fp16 index correctly.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Alex Bennée <alex.bennee@linaro.org>
Message-id: 20180627043328.11531-31-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-a64.c | 21 ++++++++++++---------
 target/arm/translate.c     | 32 +++++++++++++++++++++++---------
 target/arm/vec_helper.c    | 10 ++++++----
 3 files changed, 41 insertions(+), 22 deletions(-)

diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
     case 0x13: /* FCMLA #90 */
     case 0x15: /* FCMLA #180 */
     case 0x17: /* FCMLA #270 */
-        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, rd),
-                           vec_full_reg_offset(s, rn),
-                           vec_reg_offset(s, rm, index, size), fpst,
-                           is_q ? 16 : 8, vec_full_reg_size(s),
-                           extract32(insn, 13, 2), /* rot */
-                           size == MO_64
-                           ? gen_helper_gvec_fcmlas_idx
-                           : gen_helper_gvec_fcmlah_idx);
-        tcg_temp_free_ptr(fpst);
+        {
+            int rot = extract32(insn, 13, 2);
+            int data = (index << 2) | rot;
+            tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, rd),
+                               vec_full_reg_offset(s, rn),
+                               vec_full_reg_offset(s, rm), fpst,
+                               is_q ? 16 : 8, vec_full_reg_size(s), data,
+                               size == MO_64
+                               ? gen_helper_gvec_fcmlas_idx
+                               : gen_helper_gvec_fcmlah_idx);
+            tcg_temp_free_ptr(fpst);
+        }
         return;
     }
 
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
 
 static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
 {
-    int rd, rn, rm, rot, size, opr_sz;
+    gen_helper_gvec_3_ptr *fn_gvec_ptr;
+    int rd, rn, rm, opr_sz, data;
     TCGv_ptr fpst;
     bool q;
 
     q = extract32(insn, 6, 1);
     VFP_DREG_D(rd, insn);
     VFP_DREG_N(rn, insn);
-    VFP_DREG_M(rm, insn);
     if ((rd | rn) & q) {
         return 1;
     }
 
     if ((insn & 0xff000f10) == 0xfe000800) {
         /* VCMLA (indexed) -- 1111 1110 S.RR .... .... 1000 ...0 .... */
-        rot = extract32(insn, 20, 2);
-        size = extract32(insn, 23, 1);
-        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)
-            || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
+        int rot = extract32(insn, 20, 2);
+        int size = extract32(insn, 23, 1);
+        int index;
+
+        if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)) {
             return 1;
         }
+        if (size == 0) {
+            if (!arm_dc_feature(s, ARM_FEATURE_V8_FP16)) {
+                return 1;
+            }
+            /* For fp16, rm is just Vm, and index is M.  */
+            rm = extract32(insn, 0, 4);
+            index = extract32(insn, 5, 1);
+        } else {
+            /* For fp32, rm is the usual M:Vm, and index is 0.  */
+            VFP_DREG_M(rm, insn);
+            index = 0;
+        }
+        data = (index << 2) | rot;
+        fn_gvec_ptr = (size ? gen_helper_gvec_fcmlas_idx
+                       : gen_helper_gvec_fcmlah_idx);
     } else {
         return 1;
     }
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
     tcg_gen_gvec_3_ptr(vfp_reg_offset(1, rd),
                        vfp_reg_offset(1, rn),
                        vfp_reg_offset(1, rm), fpst,
-                       opr_sz, opr_sz, rot,
-                       size ? gen_helper_gvec_fcmlas_idx
-                       : gen_helper_gvec_fcmlah_idx);
+                       opr_sz, opr_sz, data, fn_gvec_ptr);
     tcg_temp_free_ptr(fpst);
     return 0;
 }
diff --git a/target/arm/vec_helper.c b/target/arm/vec_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/vec_helper.c
+++ b/target/arm/vec_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(gvec_fcmlah_idx)(void *vd, void *vn, void *vm,
     float_status *fpst = vfpst;
     intptr_t flip = extract32(desc, SIMD_DATA_SHIFT, 1);
     uint32_t neg_imag = extract32(desc, SIMD_DATA_SHIFT + 1, 1);
+    intptr_t index = extract32(desc, SIMD_DATA_SHIFT + 2, 2);
     uint32_t neg_real = flip ^ neg_imag;
     uintptr_t i;
-    float16 e1 = m[H2(flip)];
-    float16 e3 = m[H2(1 - flip)];
+    float16 e1 = m[H2(2 * index + flip)];
+    float16 e3 = m[H2(2 * index + 1 - flip)];
 
     /* Shift boolean to the sign bit so we can xor to negate.  */
     neg_real <<= 15;
@@ -XXX,XX +XXX,XX @@ void HELPER(gvec_fcmlas_idx)(void *vd, void *vn, void *vm,
     float_status *fpst = vfpst;
     intptr_t flip = extract32(desc, SIMD_DATA_SHIFT, 1);
     uint32_t neg_imag = extract32(desc, SIMD_DATA_SHIFT + 1, 1);
+    intptr_t index = extract32(desc, SIMD_DATA_SHIFT + 2, 2);
     uint32_t neg_real = flip ^ neg_imag;
     uintptr_t i;
-    float32 e1 = m[H4(flip)];
-    float32 e3 = m[H4(1 - flip)];
+    float32 e1 = m[H4(2 * index + flip)];
+    float32 e3 = m[H4(2 * index + 1 - flip)];
 
     /* Shift boolean to the sign bit so we can xor to negate.  */
     neg_real <<= 31;
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

Enhance the existing helpers to support SVE, which takes the
index from each 128-bit segment.  The change has no effect
for AdvSIMD, since there is only one such segment.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Alex Bennée <alex.bennee@linaro.org>
Message-id: 20180627043328.11531-32-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/translate-sve.c | 23 ++++++++++++++++++
 target/arm/vec_helper.c    | 50 +++++++++++++++++++++++---------------
 target/arm/sve.decode      |  6 +++++
 3 files changed, 59 insertions(+), 20 deletions(-)

diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_FCMLA_zpzzz(DisasContext *s,
     return true;
 }
 
+static bool trans_FCMLA_zzxz(DisasContext *s, arg_FCMLA_zzxz *a, uint32_t insn)
+{
+    static gen_helper_gvec_3_ptr * const fns[2] = {
+        gen_helper_gvec_fcmlah_idx,
+        gen_helper_gvec_fcmlas_idx,
+    };
+
+    tcg_debug_assert(a->esz == 1 || a->esz == 2);
+    tcg_debug_assert(a->rd == a->ra);
+    if (sve_access_check(s)) {
+        unsigned vsz = vec_full_reg_size(s);
+        TCGv_ptr status = get_fpstatus_ptr(a->esz == MO_16);
+        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, a->rd),
+                           vec_full_reg_offset(s, a->rn),
+                           vec_full_reg_offset(s, a->rm),
+                           status, vsz, vsz,
+                           a->index * 4 + a->rot,
+                           fns[a->esz - 1]);
+        tcg_temp_free_ptr(status);
+    }
+    return true;
+}
+
 /*
  *** SVE Floating Point Unary Operations Predicated Group
  */
diff --git a/target/arm/vec_helper.c b/target/arm/vec_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/vec_helper.c
+++ b/target/arm/vec_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(gvec_fcmlah_idx)(void *vd, void *vn, void *vm,
     uint32_t neg_imag = extract32(desc, SIMD_DATA_SHIFT + 1, 1);
     intptr_t index = extract32(desc, SIMD_DATA_SHIFT + 2, 2);
     uint32_t neg_real = flip ^ neg_imag;
-    uintptr_t i;
-    float16 e1 = m[H2(2 * index + flip)];
-    float16 e3 = m[H2(2 * index + 1 - flip)];
+    intptr_t elements = opr_sz / sizeof(float16);
+    intptr_t eltspersegment = 16 / sizeof(float16);
+    intptr_t i, j;
 
     /* Shift boolean to the sign bit so we can xor to negate.  */
     neg_real <<= 15;
     neg_imag <<= 15;
-    e1 ^= neg_real;
-    e3 ^= neg_imag;
 
-    for (i = 0; i < opr_sz / 2; i += 2) {
-        float16 e2 = n[H2(i + flip)];
-        float16 e4 = e2;
+    for (i = 0; i < elements; i += eltspersegment) {
+        float16 mr = m[H2(i + 2 * index + 0)];
+        float16 mi = m[H2(i + 2 * index + 1)];
+        float16 e1 = neg_real ^ (flip ? mi : mr);
+        float16 e3 = neg_imag ^ (flip ? mr : mi);
 
-        d[H2(i)] = float16_muladd(e2, e1, d[H2(i)], 0, fpst);
-        d[H2(i + 1)] = float16_muladd(e4, e3, d[H2(i + 1)], 0, fpst);
+        for (j = i; j < i + eltspersegment; j += 2) {
+            float16 e2 = n[H2(j + flip)];
+            float16 e4 = e2;
+
+            d[H2(j)] = float16_muladd(e2, e1, d[H2(j)], 0, fpst);
+            d[H2(j + 1)] = float16_muladd(e4, e3, d[H2(j + 1)], 0, fpst);
+        }
     }
     clear_tail(d, opr_sz, simd_maxsz(desc));
 }
@@ -XXX,XX +XXX,XX @@ void HELPER(gvec_fcmlas_idx)(void *vd, void *vn, void *vm,
     uint32_t neg_imag = extract32(desc, SIMD_DATA_SHIFT + 1, 1);
     intptr_t index = extract32(desc, SIMD_DATA_SHIFT + 2, 2);
     uint32_t neg_real = flip ^ neg_imag;
-    uintptr_t i;
-    float32 e1 = m[H4(2 * index + flip)];
-    float32 e3 = m[H4(2 * index + 1 - flip)];
+    intptr_t elements = opr_sz / sizeof(float32);
+    intptr_t eltspersegment = 16 / sizeof(float32);
+    intptr_t i, j;
 
     /* Shift boolean to the sign bit so we can xor to negate.  */
     neg_real <<= 31;
     neg_imag <<= 31;
-    e1 ^= neg_real;
-    e3 ^= neg_imag;
 
-    for (i = 0; i < opr_sz / 4; i += 2) {
-        float32 e2 = n[H4(i + flip)];
-        float32 e4 = e2;
+    for (i = 0; i < elements; i += eltspersegment) {
+        float32 mr = m[H4(i + 2 * index + 0)];
+        float32 mi = m[H4(i + 2 * index + 1)];
+        float32 e1 = neg_real ^ (flip ? mi : mr);
+        float32 e3 = neg_imag ^ (flip ? mr : mi);
 
-        d[H4(i)] = float32_muladd(e2, e1, d[H4(i)], 0, fpst);
-        d[H4(i + 1)] = float32_muladd(e4, e3, d[H4(i + 1)], 0, fpst);
+        for (j = i; j < i + eltspersegment; j += 2) {
+            float32 e2 = n[H4(j + flip)];
+            float32 e4 = e2;
+
+            d[H4(j)] = float32_muladd(e2, e1, d[H4(j)], 0, fpst);
+            d[H4(j + 1)] = float32_muladd(e4, e3, d[H4(j + 1)], 0, fpst);
+        }
     }
     clear_tail(d, opr_sz, simd_maxsz(desc));
 }
diff --git a/target/arm/sve.decode b/target/arm/sve.decode
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve.decode
+++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@ FCADD           01100100 esz:2 00000 rot:1 100 pg:3 rm:5 rd:5 \
 FCMLA_zpzzz     01100100 esz:2 0 rm:5 0 rot:2 pg:3 rn:5 rd:5 \
                 ra=%reg_movprfx
 
+# SVE floating-point complex multiply-add (indexed)
+FCMLA_zzxz      01100100 10 1 index:2 rm:3 0001 rot:2 rn:5 rd:5 \
+                ra=%reg_movprfx esz=1
+FCMLA_zzxz      01100100 11 1 index:1 rm:4 0001 rot:2 rn:5 rd:5 \
+                ra=%reg_movprfx esz=2
+
 ### SVE FP Multiply-Add Indexed Group
 
 # SVE floating-point multiply-add (indexed)
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-33-richard.henderson@linaro.org
[PMM: moved 'ra=%reg_movprfx' here from following patch]
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper.h        |  5 +++
 target/arm/translate-sve.c | 17 ++++++++++
 target/arm/vec_helper.c    | 67 ++++++++++++++++++++++++++++++++++++++
 target/arm/sve.decode      |  3 ++
 4 files changed, 92 insertions(+)

From: Richard Henderson <richard.henderson@linaro.org>

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Alex Bennée <alex.bennee@linaro.org>
Message-id: 20180627043328.11531-34-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper.h        |   5 ++
 target/arm/translate-sve.c |  18 ++++++
 target/arm/vec_helper.c    | 124 +++++++++++++++++++++++++++++++++++++
 target/arm/sve.decode      |   6 ++
 4 files changed, 153 insertions(+)

diff --git a/target/arm/helper.h b/target/arm/helper.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.h
+++ b/target/arm/helper.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_FLAGS_4(gvec_udot_b, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
 DEF_HELPER_FLAGS_4(gvec_sdot_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
 DEF_HELPER_FLAGS_4(gvec_udot_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
 
+DEF_HELPER_FLAGS_4(gvec_sdot_idx_b, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
+DEF_HELPER_FLAGS_4(gvec_udot_idx_b, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
+DEF_HELPER_FLAGS_4(gvec_sdot_idx_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
+DEF_HELPER_FLAGS_4(gvec_udot_idx_h, TCG_CALL_NO_RWG, void, ptr, ptr, ptr, i32)
+
 DEF_HELPER_FLAGS_5(gvec_fcaddh, TCG_CALL_NO_RWG,
                    void, ptr, ptr, ptr, ptr, i32)
 DEF_HELPER_FLAGS_5(gvec_fcadds, TCG_CALL_NO_RWG,
diff --git a/target/arm/translate-sve.c b/target/arm/translate-sve.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-sve.c
+++ b/target/arm/translate-sve.c
@@ -XXX,XX +XXX,XX @@ static bool trans_DOT_zzz(DisasContext *s, arg_DOT_zzz *a, uint32_t insn)
     return true;
 }
 
+static bool trans_DOT_zzx(DisasContext *s, arg_DOT_zzx *a, uint32_t insn)
+{
+    static gen_helper_gvec_3 * const fns[2][2] = {
+        { gen_helper_gvec_sdot_idx_b, gen_helper_gvec_sdot_idx_h },
+        { gen_helper_gvec_udot_idx_b, gen_helper_gvec_udot_idx_h }
+    };
+
+    if (sve_access_check(s)) {
+        unsigned vsz = vec_full_reg_size(s);
+        tcg_gen_gvec_3_ool(vec_full_reg_offset(s, a->rd),
+                           vec_full_reg_offset(s, a->rn),
+                           vec_full_reg_offset(s, a->rm),
+                           vsz, vsz, a->index, fns[a->u][a->sz]);
+    }
+    return true;
+}
+
+
 /*
  *** SVE Floating Point Multiply-Add Indexed Group
  */
diff --git a/target/arm/vec_helper.c b/target/arm/vec_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/vec_helper.c
+++ b/target/arm/vec_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(gvec_udot_h)(void *vd, void *vn, void *vm, uint32_t desc)
     clear_tail(d, opr_sz, simd_maxsz(desc));
 }
 
+void HELPER(gvec_sdot_idx_b)(void *vd, void *vn, void *vm, uint32_t desc)
+{
+    intptr_t i, segend, opr_sz = simd_oprsz(desc), opr_sz_4 = opr_sz / 4;
+    intptr_t index = simd_data(desc);
+    uint32_t *d = vd;
+    int8_t *n = vn;
+    int8_t *m_indexed = (int8_t *)vm + index * 4;
+
+    /* Notice the special case of opr_sz == 8, from aa64/aa32 advsimd.
+     * Otherwise opr_sz is a multiple of 16.
+     */
+    segend = MIN(4, opr_sz_4);
+    i = 0;
+    do {
+        int8_t m0 = m_indexed[i * 4 + 0];
+        int8_t m1 = m_indexed[i * 4 + 1];
+        int8_t m2 = m_indexed[i * 4 + 2];
+        int8_t m3 = m_indexed[i * 4 + 3];
+
+        do {
+            d[i] += n[i * 4 + 0] * m0
+                  + n[i * 4 + 1] * m1
+                  + n[i * 4 + 2] * m2
+                  + n[i * 4 + 3] * m3;
+        } while (++i < segend);
+        segend = i + 4;
+    } while (i < opr_sz_4);
+
+    clear_tail(d, opr_sz, simd_maxsz(desc));
+}
+
+void HELPER(gvec_udot_idx_b)(void *vd, void *vn, void *vm, uint32_t desc)
+{
+    intptr_t i, segend, opr_sz = simd_oprsz(desc), opr_sz_4 = opr_sz / 4;
+    intptr_t index = simd_data(desc);
+    uint32_t *d = vd;
+    uint8_t *n = vn;
+    uint8_t *m_indexed = (uint8_t *)vm + index * 4;
+
+    /* Notice the special case of opr_sz == 8, from aa64/aa32 advsimd.
+     * Otherwise opr_sz is a multiple of 16.
+     */
+    segend = MIN(4, opr_sz_4);
+    i = 0;
+    do {
+        uint8_t m0 = m_indexed[i * 4 + 0];
+        uint8_t m1 = m_indexed[i * 4 + 1];
+        uint8_t m2 = m_indexed[i * 4 + 2];
+        uint8_t m3 = m_indexed[i * 4 + 3];
+
+        do {
+            d[i] += n[i * 4 + 0] * m0
+                  + n[i * 4 + 1] * m1
+                  + n[i * 4 + 2] * m2
+                  + n[i * 4 + 3] * m3;
+        } while (++i < segend);
+        segend = i + 4;
+    } while (i < opr_sz_4);
+
+    clear_tail(d, opr_sz, simd_maxsz(desc));
+}
+
+void HELPER(gvec_sdot_idx_h)(void *vd, void *vn, void *vm, uint32_t desc)
+{
+    intptr_t i, opr_sz = simd_oprsz(desc), opr_sz_8 = opr_sz / 8;
+    intptr_t index = simd_data(desc);
+    uint64_t *d = vd;
+    int16_t *n = vn;
+    int16_t *m_indexed = (int16_t *)vm + index * 4;
+
+    /* This is supported by SVE only, so opr_sz is always a multiple of 16.
+     * Process the entire segment all at once, writing back the results
+     * only after we've consumed all of the inputs.
+     */
+    for (i = 0; i < opr_sz_8 ; i += 2) {
+        uint64_t d0, d1;
+
+        d0  = n[i * 4 + 0] * (int64_t)m_indexed[i * 4 + 0];
+        d0 += n[i * 4 + 1] * (int64_t)m_indexed[i * 4 + 1];
+        d0 += n[i * 4 + 2] * (int64_t)m_indexed[i * 4 + 2];
+        d0 += n[i * 4 + 3] * (int64_t)m_indexed[i * 4 + 3];
+        d1  = n[i * 4 + 4] * (int64_t)m_indexed[i * 4 + 0];
+        d1 += n[i * 4 + 5] * (int64_t)m_indexed[i * 4 + 1];
+        d1 += n[i * 4 + 6] * (int64_t)m_indexed[i * 4 + 2];
+        d1 += n[i * 4 + 7] * (int64_t)m_indexed[i * 4 + 3];
+
+        d[i + 0] += d0;
+        d[i + 1] += d1;
+    }
+
+    clear_tail(d, opr_sz, simd_maxsz(desc));
+}
+
+void HELPER(gvec_udot_idx_h)(void *vd, void *vn, void *vm, uint32_t desc)
+{
+    intptr_t i, opr_sz = simd_oprsz(desc), opr_sz_8 = opr_sz / 8;
+    intptr_t index = simd_data(desc);
+    uint64_t *d = vd;
+    uint16_t *n = vn;
+    uint16_t *m_indexed = (uint16_t *)vm + index * 4;
+
+    /* This is supported by SVE only, so opr_sz is always a multiple of 16.
+     * Process the entire segment all at once, writing back the results
+     * only after we've consumed all of the inputs.
+     */
+    for (i = 0; i < opr_sz_8 ; i += 2) {
+        uint64_t d0, d1;
+
+        d0  = n[i * 4 + 0] * (uint64_t)m_indexed[i * 4 + 0];
+        d0 += n[i * 4 + 1] * (uint64_t)m_indexed[i * 4 + 1];
+        d0 += n[i * 4 + 2] * (uint64_t)m_indexed[i * 4 + 2];
+        d0 += n[i * 4 + 3] * (uint64_t)m_indexed[i * 4 + 3];
+        d1  = n[i * 4 + 4] * (uint64_t)m_indexed[i * 4 + 0];
+        d1 += n[i * 4 + 5] * (uint64_t)m_indexed[i * 4 + 1];
+        d1 += n[i * 4 + 6] * (uint64_t)m_indexed[i * 4 + 2];
+        d1 += n[i * 4 + 7] * (uint64_t)m_indexed[i * 4 + 3];
+
+        d[i + 0] += d0;
+        d[i + 1] += d1;
+    }
+
+    clear_tail(d, opr_sz, simd_maxsz(desc));
+}
+
 void HELPER(gvec_fcaddh)(void *vd, void *vn, void *vm,
                          void *vfpst, uint32_t desc)
 {
diff --git a/target/arm/sve.decode b/target/arm/sve.decode
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve.decode
+++ b/target/arm/sve.decode
@@ -XXX,XX +XXX,XX @@ MUL_zzi         00100101 .. 110 000 110 ........ .....          @rdn_i8s
 # SVE integer dot product (unpredicated)
 DOT_zzz         01000100 1 sz:1 0 rm:5 00000 u:1 rn:5 rd:5      ra=%reg_movprfx
 
+# SVE integer dot product (indexed)
+DOT_zzx         01000100 101 index:2 rm:3 00000 u:1 rn:5 rd:5 \
+                sz=0 ra=%reg_movprfx
+DOT_zzx         01000100 111 index:1 rm:4 00000 u:1 rn:5 rd:5 \
+                sz=1 ra=%reg_movprfx
+
 # SVE floating-point complex add (predicated)
 FCADD           01100100 esz:2 00000 rot:1 100 pg:3 rm:5 rd:5 \
                 rn=%reg_movprfx
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

Enable ARM_FEATURE_SVE for the generic "max" cpu.

Tested-by: Alex Bennée <alex.bennee@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-35-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 linux-user/elfload.c | 1 +
 target/arm/cpu.c     | 7 +++++++
 target/arm/cpu64.c   | 1 +
 3 files changed, 9 insertions(+)

diff --git a/linux-user/elfload.c b/linux-user/elfload.c
index XXXXXXX..XXXXXXX 100644
--- a/linux-user/elfload.c
+++ b/linux-user/elfload.c
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
     GET_FEATURE(ARM_FEATURE_V8_ATOMICS, ARM_HWCAP_A64_ATOMICS);
     GET_FEATURE(ARM_FEATURE_V8_RDM, ARM_HWCAP_A64_ASIMDRDM);
     GET_FEATURE(ARM_FEATURE_V8_FCMA, ARM_HWCAP_A64_FCMA);
+    GET_FEATURE(ARM_FEATURE_SVE, ARM_HWCAP_A64_SVE);
 #undef GET_FEATURE
 
     return hwcaps;
diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_reset(CPUState *s)
         env->cp15.sctlr_el[1] |= SCTLR_UCT | SCTLR_UCI | SCTLR_DZE;
         /* and to the FP/Neon instructions */
         env->cp15.cpacr_el1 = deposit64(env->cp15.cpacr_el1, 20, 2, 3);
+        /* and to the SVE instructions */
+        env->cp15.cpacr_el1 = deposit64(env->cp15.cpacr_el1, 16, 2, 3);
+        env->cp15.cptr_el[3] |= CPTR_EZ;
+        /* with maximum vector length */
+        env->vfp.zcr_el[1] = ARM_MAX_VQ - 1;
+        env->vfp.zcr_el[2] = ARM_MAX_VQ - 1;
+        env->vfp.zcr_el[3] = ARM_MAX_VQ - 1;
 #else
         /* Reset into the highest available EL */
         if (arm_feature(env, ARM_FEATURE_EL3)) {
diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu64.c
+++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
         set_feature(&cpu->env, ARM_FEATURE_V8_RDM);
         set_feature(&cpu->env, ARM_FEATURE_V8_FP16);
         set_feature(&cpu->env, ARM_FEATURE_V8_FCMA);
+        set_feature(&cpu->env, ARM_FEATURE_SVE);
         /* For usermode -cpu max we can use a larger and more efficient DCZ
          * blocksize since we don't have to follow what the hardware does.
          */
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

We've already added the helpers with an SVE patch, all that remains
is to wire up the aa64 and aa32 translators.  Enable the feature
within -cpu max for CONFIG_USER_ONLY.

Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180627043328.11531-36-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h           |  1 +
 linux-user/elfload.c       |  1 +
 target/arm/cpu.c           |  1 +
 target/arm/cpu64.c         |  1 +
 target/arm/translate-a64.c | 36 +++++++++++++++++++
 target/arm/translate.c     | 74 +++++++++++++++++++++++++++-----------
 6 files changed, 93 insertions(+), 21 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ enum arm_features {
     ARM_FEATURE_V8_SM4, /* implements SM4 part of v8 Crypto Extensions */
     ARM_FEATURE_V8_ATOMICS, /* ARMv8.1-Atomics feature */
     ARM_FEATURE_V8_RDM, /* implements v8.1 simd round multiply */
+    ARM_FEATURE_V8_DOTPROD, /* implements v8.2 simd dot product */
     ARM_FEATURE_V8_FP16, /* implements v8.2 half-precision float */
     ARM_FEATURE_V8_FCMA, /* has complex number part of v8.3 extensions.  */
     ARM_FEATURE_M_MAIN, /* M profile Main Extension */
diff --git a/linux-user/elfload.c b/linux-user/elfload.c
index XXXXXXX..XXXXXXX 100644
--- a/linux-user/elfload.c
+++ b/linux-user/elfload.c
@@ -XXX,XX +XXX,XX @@ static uint32_t get_elf_hwcap(void)
                 ARM_HWCAP_A64_FPHP | ARM_HWCAP_A64_ASIMDHP);
     GET_FEATURE(ARM_FEATURE_V8_ATOMICS, ARM_HWCAP_A64_ATOMICS);
     GET_FEATURE(ARM_FEATURE_V8_RDM, ARM_HWCAP_A64_ASIMDRDM);
+    GET_FEATURE(ARM_FEATURE_V8_DOTPROD, ARM_HWCAP_A64_ASIMDDP);
     GET_FEATURE(ARM_FEATURE_V8_FCMA, ARM_HWCAP_A64_FCMA);
     GET_FEATURE(ARM_FEATURE_SVE, ARM_HWCAP_A64_SVE);
 #undef GET_FEATURE
diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_max_initfn(Object *obj)
         set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
         set_feature(&cpu->env, ARM_FEATURE_CRC);
         set_feature(&cpu->env, ARM_FEATURE_V8_RDM);
+        set_feature(&cpu->env, ARM_FEATURE_V8_DOTPROD);
         set_feature(&cpu->env, ARM_FEATURE_V8_FCMA);
 #endif
     }
diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu64.c
+++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
         set_feature(&cpu->env, ARM_FEATURE_CRC);
         set_feature(&cpu->env, ARM_FEATURE_V8_ATOMICS);
         set_feature(&cpu->env, ARM_FEATURE_V8_RDM);
+        set_feature(&cpu->env, ARM_FEATURE_V8_DOTPROD);
         set_feature(&cpu->env, ARM_FEATURE_V8_FP16);
         set_feature(&cpu->env, ARM_FEATURE_V8_FCMA);
         set_feature(&cpu->env, ARM_FEATURE_SVE);
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void gen_gvec_op3(DisasContext *s, bool is_q, int rd,
                    vec_full_reg_size(s), gvec_op);
 }
 
+/* Expand a 3-operand operation using an out-of-line helper.  */
+static void gen_gvec_op3_ool(DisasContext *s, bool is_q, int rd,
+                             int rn, int rm, int data, gen_helper_gvec_3 *fn)
+{
+    tcg_gen_gvec_3_ool(vec_full_reg_offset(s, rd),
+                       vec_full_reg_offset(s, rn),
+                       vec_full_reg_offset(s, rm),
+                       is_q ? 16 : 8, vec_full_reg_size(s), data, fn);
+}
+
 /* Expand a 3-operand + env pointer operation using
  * an out-of-line helper.
  */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
         }
         feature = ARM_FEATURE_V8_RDM;
         break;
+    case 0x02: /* SDOT (vector) */
+    case 0x12: /* UDOT (vector) */
+        if (size != MO_32) {
+            unallocated_encoding(s);
+            return;
+        }
+        feature = ARM_FEATURE_V8_DOTPROD;
+        break;
     case 0x8: /* FCMLA, #0 */
     case 0x9: /* FCMLA, #90 */
     case 0xa: /* FCMLA, #180 */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_three_reg_same_extra(DisasContext *s, uint32_t insn)
         }
         return;
 
+    case 0x2: /* SDOT / UDOT */
+        gen_gvec_op3_ool(s, is_q, rd, rn, rm, 0,
+                         u ? gen_helper_gvec_udot_b : gen_helper_gvec_sdot_b);
+        return;
+
     case 0x8: /* FCMLA, #0 */
     case 0x9: /* FCMLA, #90 */
     case 0xa: /* FCMLA, #180 */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
             return;
         }
         break;
+    case 0x0e: /* SDOT */
+    case 0x1e: /* UDOT */
+        if (size != MO_32 || !arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
+            unallocated_encoding(s);
+            return;
+        }
+        break;
     case 0x11: /* FCMLA #0 */
     case 0x13: /* FCMLA #90 */
     case 0x15: /* FCMLA #180 */
@@ -XXX,XX +XXX,XX @@ static void disas_simd_indexed(DisasContext *s, uint32_t insn)
     }
 
     switch (16 * u + opcode) {
+    case 0x0e: /* SDOT */
+    case 0x1e: /* UDOT */
+        gen_gvec_op3_ool(s, is_q, rd, rn, rm, index,
+                         u ? gen_helper_gvec_udot_idx_b
+                         : gen_helper_gvec_sdot_idx_b);
+        return;
     case 0x11: /* FCMLA #0 */
     case 0x13: /* FCMLA #90 */
     case 0x15: /* FCMLA #180 */
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_neon_data_insn(DisasContext *s, uint32_t insn)
  */
 static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
 {
-    gen_helper_gvec_3_ptr *fn_gvec_ptr;
-    int rd, rn, rm, rot, size, opr_sz;
-    TCGv_ptr fpst;
+    gen_helper_gvec_3 *fn_gvec = NULL;
+    gen_helper_gvec_3_ptr *fn_gvec_ptr = NULL;
+    int rd, rn, rm, opr_sz;
+    int data = 0;
     bool q;
 
     q = extract32(insn, 6, 1);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
 
     if ((insn & 0xfe200f10) == 0xfc200800) {
         /* VCMLA -- 1111 110R R.1S .... .... 1000 ...0 .... */
-        size = extract32(insn, 20, 1);
-        rot = extract32(insn, 23, 2);
+        int size = extract32(insn, 20, 1);
+        data = extract32(insn, 23, 2); /* rot */
         if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)
             || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
             return 1;
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
         fn_gvec_ptr = size ? gen_helper_gvec_fcmlas : gen_helper_gvec_fcmlah;
     } else if ((insn & 0xfea00f10) == 0xfc800800) {
         /* VCADD -- 1111 110R 1.0S .... .... 1000 ...0 .... */
-        size = extract32(insn, 20, 1);
-        rot = extract32(insn, 24, 1);
+        int size = extract32(insn, 20, 1);
+        data = extract32(insn, 24, 1); /* rot */
         if (!arm_dc_feature(s, ARM_FEATURE_V8_FCMA)
             || (!size && !arm_dc_feature(s, ARM_FEATURE_V8_FP16))) {
             return 1;
         }
         fn_gvec_ptr = size ? gen_helper_gvec_fcadds : gen_helper_gvec_fcaddh;
+    } else if ((insn & 0xfeb00f00) == 0xfc200d00) {
+        /* V[US]DOT -- 1111 1100 0.10 .... .... 1101 .Q.U .... */
+        bool u = extract32(insn, 4, 1);
+        if (!arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
+            return 1;
+        }
+        fn_gvec = u ? gen_helper_gvec_udot_b : gen_helper_gvec_sdot_b;
     } else {
         return 1;
     }
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
     }
 
     opr_sz = (1 + q) * 8;
-    fpst = get_fpstatus_ptr(1);
-    tcg_gen_gvec_3_ptr(vfp_reg_offset(1, rd),
-                       vfp_reg_offset(1, rn),
-                       vfp_reg_offset(1, rm), fpst,
-                       opr_sz, opr_sz, rot, fn_gvec_ptr);
-    tcg_temp_free_ptr(fpst);
+    if (fn_gvec_ptr) {
+        TCGv_ptr fpst = get_fpstatus_ptr(1);
+        tcg_gen_gvec_3_ptr(vfp_reg_offset(1, rd),
+                           vfp_reg_offset(1, rn),
+                           vfp_reg_offset(1, rm), fpst,
+                           opr_sz, opr_sz, data, fn_gvec_ptr);
+        tcg_temp_free_ptr(fpst);
+    } else {
+        tcg_gen_gvec_3_ool(vfp_reg_offset(1, rd),
+                           vfp_reg_offset(1, rn),
+                           vfp_reg_offset(1, rm),
+                           opr_sz, opr_sz, data, fn_gvec);
+    }
     return 0;
 }
 
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_3same_ext(DisasContext *s, uint32_t insn)
 
 static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
 {
-    gen_helper_gvec_3_ptr *fn_gvec_ptr;
+    gen_helper_gvec_3 *fn_gvec = NULL;
+    gen_helper_gvec_3_ptr *fn_gvec_ptr = NULL;
     int rd, rn, rm, opr_sz, data;
-    TCGv_ptr fpst;
     bool q;
 
     q = extract32(insn, 6, 1);
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
         data = (index << 2) | rot;
         fn_gvec_ptr = (size ? gen_helper_gvec_fcmlas_idx
                        : gen_helper_gvec_fcmlah_idx);
+    } else if ((insn & 0xffb00f00) == 0xfe200d00) {
+        /* V[US]DOT -- 1111 1110 0.10 .... .... 1101 .Q.U .... */
+        int u = extract32(insn, 4, 1);
+        if (!arm_dc_feature(s, ARM_FEATURE_V8_DOTPROD)) {
+            return 1;
+        }
+        fn_gvec = u ? gen_helper_gvec_udot_idx_b : gen_helper_gvec_sdot_idx_b;
+        /* rm is just Vm, and index is M.  */
+        data = extract32(insn, 5, 1); /* index */
+        rm = extract32(insn, 0, 4);
     } else {
         return 1;
     }
@@ -XXX,XX +XXX,XX @@ static int disas_neon_insn_2reg_scalar_ext(DisasContext *s, uint32_t insn)
     }
 
     opr_sz = (1 + q) * 8;
-    fpst = get_fpstatus_ptr(1);
-    tcg_gen_gvec_3_ptr(vfp_reg_offset(1, rd),
-                       vfp_reg_offset(1, rn),
-                       vfp_reg_offset(1, rm), fpst,
-                       opr_sz, opr_sz, data, fn_gvec_ptr);
-    tcg_temp_free_ptr(fpst);
+    if (fn_gvec_ptr) {
+        TCGv_ptr fpst = get_fpstatus_ptr(1);
+        tcg_gen_gvec_3_ptr(vfp_reg_offset(1, rd),
+                           vfp_reg_offset(1, rn),
+                           vfp_reg_offset(1, rm), fpst,
+                           opr_sz, opr_sz, data, fn_gvec_ptr);
+        tcg_temp_free_ptr(fpst);
+    } else {
+        tcg_gen_gvec_3_ool(vfp_reg_offset(1, rd),
+                           vfp_reg_offset(1, rn),
+                           vfp_reg_offset(1, rm),
+                           opr_sz, opr_sz, data, fn_gvec);
+    }
     return 0;
 }
 
-- 
2.17.1

From: Alex Bennée <alex.bennee@linaro.org>

Since kernel commit a86bd139f2 (arm64: arch_timer: Enable CNTVCT_EL0
trap..), released in kernel version v4.12, user-space has been able
to read these system registers. As we can't use QEMUTimer's in
linux-user mode we just directly call cpu_get_clock().

Signed-off-by: Alex Bennée <alex.bennee@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20180625160009.17437-2-alex.bennee@linaro.org
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper.c | 27 ++++++++++++++++++++++++---
 1 file changed, 24 insertions(+), 3 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo generic_timer_cp_reginfo[] = {
 };
 
 #else
-/* In user-mode none of the generic timer registers are accessible,
- * and their implementation depends on QEMU_CLOCK_VIRTUAL and qdev gpio outputs,
- * so instead just don't register any of them.
+
+/* In user-mode most of the generic timer registers are inaccessible
+ * however modern kernels (4.12+) allow access to cntvct_el0
  */
+
+static uint64_t gt_virt_cnt_read(CPUARMState *env, const ARMCPRegInfo *ri)
+{
+    /* Currently we have no support for QEMUTimer in linux-user so we
+     * can't call gt_get_countervalue(env), instead we directly
+     * call the lower level functions.
+     */
+    return cpu_get_clock() / GTIMER_SCALE;
+}
+
 static const ARMCPRegInfo generic_timer_cp_reginfo[] = {
+    { .name = "CNTFRQ_EL0", .state = ARM_CP_STATE_AA64,
+      .opc0 = 3, .opc1 = 3, .crn = 14, .crm = 0, .opc2 = 0,
+      .type = ARM_CP_CONST, .access = PL0_R /* no PL1_RW in linux-user */,
+      .fieldoffset = offsetof(CPUARMState, cp15.c14_cntfrq),
+      .resetvalue = NANOSECONDS_PER_SECOND / GTIMER_SCALE,
+    },
+    { .name = "CNTVCT_EL0", .state = ARM_CP_STATE_AA64,
+      .opc0 = 3, .opc1 = 3, .crn = 14, .crm = 0, .opc2 = 2,
+      .access = PL0_R, .type = ARM_CP_NO_RAW | ARM_CP_IO,
+      .readfn = gt_virt_cnt_read,
+    },
     REGINFO_SENTINEL
 };
 
-- 
2.17.1

From: Jean-Christophe Dubois <jcd@tribudubois.net>

The qdev_get_gpio_in() function accept an int as second parameter.

Signed-off-by: Jean-Christophe Dubois <jcd@tribudubois.net>
Reviewed-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/arm/fsl-imx7.c | 6 +++---
 1 file changed, 3 insertions(+), 3 deletions(-)

diff --git a/hw/arm/fsl-imx7.c b/hw/arm/fsl-imx7.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/fsl-imx7.c
+++ b/hw/arm/fsl-imx7.c
@@ -XXX,XX +XXX,XX @@ static void fsl_imx7_realize(DeviceState *dev, Error **errp)
             FSL_IMX7_ECSPI4_ADDR,
         };
 
-        static const hwaddr FSL_IMX7_SPIn_IRQ[FSL_IMX7_NUM_ECSPIS] = {
+        static const int FSL_IMX7_SPIn_IRQ[FSL_IMX7_NUM_ECSPIS] = {
             FSL_IMX7_ECSPI1_IRQ,
             FSL_IMX7_ECSPI2_IRQ,
             FSL_IMX7_ECSPI3_IRQ,
@@ -XXX,XX +XXX,XX @@ static void fsl_imx7_realize(DeviceState *dev, Error **errp)
             FSL_IMX7_I2C4_ADDR,
         };
 
-        static const hwaddr FSL_IMX7_I2Cn_IRQ[FSL_IMX7_NUM_I2CS] = {
+        static const int FSL_IMX7_I2Cn_IRQ[FSL_IMX7_NUM_I2CS] = {
             FSL_IMX7_I2C1_IRQ,
             FSL_IMX7_I2C2_IRQ,
             FSL_IMX7_I2C3_IRQ,
@@ -XXX,XX +XXX,XX @@ static void fsl_imx7_realize(DeviceState *dev, Error **errp)
             FSL_IMX7_USB3_ADDR,
         };
 
-        static const hwaddr FSL_IMX7_USBn_IRQ[FSL_IMX7_NUM_USBS] = {
+        static const int FSL_IMX7_USBn_IRQ[FSL_IMX7_NUM_USBS] = {
             FSL_IMX7_USB1_IRQ,
             FSL_IMX7_USB2_IRQ,
             FSL_IMX7_USB3_IRQ,
-- 
2.17.1

From: Aaron Lindsay <alindsay@codeaurora.org>

Signed-off-by: Aaron Lindsay <alindsay@codeaurora.org>
Message-id: 1529699547-17044-5-git-send-email-alindsay@codeaurora.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h   |  1 +
 target/arm/cpu.c   | 21 ++++++++++++++-------
 target/arm/kvm32.c |  8 ++++----
 3 files changed, 19 insertions(+), 11 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ enum arm_features {
     ARM_FEATURE_OMAPCP, /* OMAP specific CP15 ops handling.  */
     ARM_FEATURE_THUMB2EE,
     ARM_FEATURE_V7MP,    /* v7 Multiprocessing Extensions */
+    ARM_FEATURE_V7VE, /* v7 Virtualization Extensions (non-EL2 parts) */
     ARM_FEATURE_V4T,
     ARM_FEATURE_V5,
     ARM_FEATURE_STRONGARM,
diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
 
     /* Some features automatically imply others: */
     if (arm_feature(env, ARM_FEATURE_V8)) {
-        set_feature(env, ARM_FEATURE_V7);
+        set_feature(env, ARM_FEATURE_V7VE);
+    }
+    if (arm_feature(env, ARM_FEATURE_V7VE)) {
+        /* v7 Virtualization Extensions. In real hardware this implies
+         * EL2 and also the presence of the Security Extensions.
+         * For QEMU, for backwards-compatibility we implement some
+         * CPUs or CPU configs which have no actual EL2 or EL3 but do
+         * include the various other features that V7VE implies.
+         * Presence of EL2 itself is ARM_FEATURE_EL2, and of the
+         * Security Extensions is ARM_FEATURE_EL3.
+         */
         set_feature(env, ARM_FEATURE_ARM_DIV);
         set_feature(env, ARM_FEATURE_LPAE);
+        set_feature(env, ARM_FEATURE_V7);
     }
     if (arm_feature(env, ARM_FEATURE_V7)) {
         set_feature(env, ARM_FEATURE_VAPA);
@@ -XXX,XX +XXX,XX @@ static void cortex_a7_initfn(Object *obj)
     ARMCPU *cpu = ARM_CPU(obj);
 
     cpu->dtb_compatible = "arm,cortex-a7";
-    set_feature(&cpu->env, ARM_FEATURE_V7);
+    set_feature(&cpu->env, ARM_FEATURE_V7VE);
     set_feature(&cpu->env, ARM_FEATURE_VFP4);
     set_feature(&cpu->env, ARM_FEATURE_NEON);
     set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
-    set_feature(&cpu->env, ARM_FEATURE_ARM_DIV);
     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
     set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
-    set_feature(&cpu->env, ARM_FEATURE_LPAE);
     set_feature(&cpu->env, ARM_FEATURE_EL3);
     cpu->kvm_target = QEMU_KVM_ARM_TARGET_CORTEX_A7;
     cpu->midr = 0x410fc075;
@@ -XXX,XX +XXX,XX @@ static void cortex_a15_initfn(Object *obj)
     ARMCPU *cpu = ARM_CPU(obj);
 
     cpu->dtb_compatible = "arm,cortex-a15";
-    set_feature(&cpu->env, ARM_FEATURE_V7);
+    set_feature(&cpu->env, ARM_FEATURE_V7VE);
     set_feature(&cpu->env, ARM_FEATURE_VFP4);
     set_feature(&cpu->env, ARM_FEATURE_NEON);
     set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
-    set_feature(&cpu->env, ARM_FEATURE_ARM_DIV);
     set_feature(&cpu->env, ARM_FEATURE_GENERIC_TIMER);
     set_feature(&cpu->env, ARM_FEATURE_DUMMY_C15_REGS);
     set_feature(&cpu->env, ARM_FEATURE_CBAR_RO);
-    set_feature(&cpu->env, ARM_FEATURE_LPAE);
     set_feature(&cpu->env, ARM_FEATURE_EL3);
     cpu->kvm_target = QEMU_KVM_ARM_TARGET_CORTEX_A15;
     cpu->midr = 0x412fc0f1;
diff --git a/target/arm/kvm32.c b/target/arm/kvm32.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/kvm32.c
+++ b/target/arm/kvm32.c
@@ -XXX,XX +XXX,XX @@ bool kvm_arm_get_host_cpu_features(ARMHostCPUFeatures *ahcf)
     /* Now we've retrieved all the register information we can
      * set the feature bits based on the ID register fields.
      * We can assume any KVM supporting CPU is at least a v7
-     * with VFPv3, LPAE and the generic timers; this in turn implies
-     * most of the other feature bits, but a few must be tested.
+     * with VFPv3, virtualization extensions, and the generic
+     * timers; this in turn implies most of the other feature
+     * bits, but a few must be tested.
      */
-    set_feature(&features, ARM_FEATURE_V7);
+    set_feature(&features, ARM_FEATURE_V7VE);
     set_feature(&features, ARM_FEATURE_VFP3);
-    set_feature(&features, ARM_FEATURE_LPAE);
     set_feature(&features, ARM_FEATURE_GENERIC_TIMER);
 
     switch (extract32(id_isar0, 24, 4)) {
-- 
2.17.1

From: Aaron Lindsay <alindsay@codeaurora.org>

KVM implies V7VE, which implies ARM_DIV and THUMB_DIV. The conditional
detection here is therefore unnecessary. Because V7VE is already
unconditionally specified for all KVM hosts, ARM_DIV and THUMB_DIV are
already indirectly specified and do not need to be included here at all.

Signed-off-by: Aaron Lindsay <alindsay@codeaurora.org>
Message-id: 1529699547-17044-6-git-send-email-alindsay@codeaurora.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/kvm32.c | 19 +------------------
 1 file changed, 1 insertion(+), 18 deletions(-)

diff --git a/target/arm/kvm32.c b/target/arm/kvm32.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/kvm32.c
+++ b/target/arm/kvm32.c
@@ -XXX,XX +XXX,XX @@ bool kvm_arm_get_host_cpu_features(ARMHostCPUFeatures *ahcf)
      * and then query that CPU for the relevant ID registers.
      */
     int i, ret, fdarray[3];
-    uint32_t midr, id_pfr0, id_isar0, mvfr1;
+    uint32_t midr, id_pfr0, mvfr1;
     uint64_t features = 0;
     /* Old kernels may not know about the PREFERRED_TARGET ioctl: however
      * we know these will only support creating one kind of guest CPU,
@@ -XXX,XX +XXX,XX @@ bool kvm_arm_get_host_cpu_features(ARMHostCPUFeatures *ahcf)
             | ENCODE_CP_REG(15, 0, 0, 0, 1, 0, 0),
             .addr = (uintptr_t)&id_pfr0,
         },
-        {
-            .id = KVM_REG_ARM | KVM_REG_SIZE_U32
-            | ENCODE_CP_REG(15, 0, 0, 0, 2, 0, 0),
-            .addr = (uintptr_t)&id_isar0,
-        },
         {
             .id = KVM_REG_ARM | KVM_REG_SIZE_U32
             | KVM_REG_ARM_VFP | KVM_REG_ARM_VFP_MVFR1,
@@ -XXX,XX +XXX,XX @@ bool kvm_arm_get_host_cpu_features(ARMHostCPUFeatures *ahcf)
     set_feature(&features, ARM_FEATURE_VFP3);
     set_feature(&features, ARM_FEATURE_GENERIC_TIMER);
 
-    switch (extract32(id_isar0, 24, 4)) {
-    case 1:
-        set_feature(&features, ARM_FEATURE_THUMB_DIV);
-        break;
-    case 2:
-        set_feature(&features, ARM_FEATURE_ARM_DIV);
-        set_feature(&features, ARM_FEATURE_THUMB_DIV);
-        break;
-    default:
-        break;
-    }
-
     if (extract32(id_pfr0, 12, 4) == 1) {
         set_feature(&features, ARM_FEATURE_THUMB2EE);
     }
-- 
2.17.1

From: Aaron Lindsay <alindsay@codeaurora.org>

This makes it match its AArch64 equivalent, PMINTENSET_EL1

Signed-off-by: Aaron Lindsay <alindsay@codeaurora.org>
Message-id: 1529699547-17044-13-git-send-email-alindsay@codeaurora.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper.c | 2 +-
 1 file changed, 1 insertion(+), 1 deletion(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo v7_cp_reginfo[] = {
       .writefn = pmuserenr_write, .raw_writefn = raw_write },
     { .name = "PMINTENSET", .cp = 15, .crn = 9, .crm = 14, .opc1 = 0, .opc2 = 1,
       .access = PL1_RW, .accessfn = access_tpm,
-      .type = ARM_CP_ALIAS,
+      .type = ARM_CP_ALIAS | ARM_CP_IO,
       .fieldoffset = offsetoflow32(CPUARMState, cp15.c9_pminten),
       .resetvalue = 0,
       .writefn = pmintenset_write, .raw_writefn = raw_write },
-- 
2.17.1

We don't actually implement SD command CRC checking, because
for almost all of our SD controllers the CRC generation is
done in hardware, and so modelling CRC generation and checking
would be a bit pointless. (The exception is that milkymist-memcard
makes the guest software compute the CRC.)

As a result almost all of our SD controller models don't bother
to set the SDRequest crc field, and the SD card model doesn't
check it. So the tracing of it in sdbus_do_command() provokes
Coverity warnings about use of uninitialized data.

Drop the CRC field from the trace; we can always add it back
if and when we do anything useful with the CRC.

Fixes Coverity issues 1386072, 1386074, 1386076, 1390571.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Message-id: 20180626180324.5537-1-peter.maydell@linaro.org
---
 hw/sd/core.c       | 2 +-
 hw/sd/trace-events | 2 +-
 2 files changed, 2 insertions(+), 2 deletions(-)

diff --git a/hw/sd/core.c b/hw/sd/core.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/sd/core.c
+++ b/hw/sd/core.c
@@ -XXX,XX +XXX,XX @@ int sdbus_do_command(SDBus *sdbus, SDRequest *req, uint8_t *response)
 {
     SDState *card = get_card(sdbus);
 
-    trace_sdbus_command(sdbus_name(sdbus), req->cmd, req->arg, req->crc);
+    trace_sdbus_command(sdbus_name(sdbus), req->cmd, req->arg);
     if (card) {
         SDCardClass *sc = SD_CARD_GET_CLASS(card);
 
diff --git a/hw/sd/trace-events b/hw/sd/trace-events
index XXXXXXX..XXXXXXX 100644
--- a/hw/sd/trace-events
+++ b/hw/sd/trace-events
@@ -XXX,XX +XXX,XX @@ bcm2835_sdhost_edm_change(const char *why, uint32_t edm) "(%s) EDM now 0x%x"
 bcm2835_sdhost_update_irq(uint32_t irq) "IRQ bits 0x%x\n"
 
 # hw/sd/core.c
-sdbus_command(const char *bus_name, uint8_t cmd, uint32_t arg, uint8_t crc) "@%s CMD%02d arg 0x%08x crc 0x%02x"
+sdbus_command(const char *bus_name, uint8_t cmd, uint32_t arg) "@%s CMD%02d arg 0x%08x"
 sdbus_read(const char *bus_name, uint8_t value) "@%s value 0x%02x"
 sdbus_write(const char *bus_name, uint8_t value) "@%s value 0x%02x"
 sdbus_set_voltage(const char *bus_name, uint16_t millivolts) "@%s %u (mV)"
-- 
2.17.1

From: Philippe Mathieu-Daudé <f4bug@amsat.org>

The load/store API will ease further code movement.

Per the Physical Layer Simplified Spec. "3.6 Bus Protocol":

"In the CMD line the Most Significant Bit (MSB) is transmitted
   first, the Least Significant Bit (LSB) is the last."

Signed-off-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/sd/bcm2835_sdhost.c    | 13 +++++--------
 hw/sd/milkymist-memcard.c |  3 +--
 hw/sd/omap_mmc.c          |  6 ++----
 hw/sd/pl181.c             | 11 ++++-------
 hw/sd/sdhci.c             | 15 +++++----------
 hw/sd/ssi-sd.c            |  6 ++----
 6 files changed, 19 insertions(+), 35 deletions(-)

diff --git a/hw/sd/bcm2835_sdhost.c b/hw/sd/bcm2835_sdhost.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/sd/bcm2835_sdhost.c
+++ b/hw/sd/bcm2835_sdhost.c
@@ -XXX,XX +XXX,XX @@ static void bcm2835_sdhost_send_command(BCM2835SDHostState *s)
         goto error;
     }
     if (!(s->cmd & SDCMD_NO_RESPONSE)) {
-#define RWORD(n) (((uint32_t)rsp[n] << 24) | (rsp[n + 1] << 16) \
-                  | (rsp[n + 2] << 8) | rsp[n + 3])
         if (rlen == 0 || (rlen == 4 && (s->cmd & SDCMD_LONG_RESPONSE))) {
             goto error;
         }
@@ -XXX,XX +XXX,XX @@ static void bcm2835_sdhost_send_command(BCM2835SDHostState *s)
             goto error;
         }
         if (rlen == 4) {
-            s->rsp[0] = RWORD(0);
+            s->rsp[0] = ldl_be_p(&rsp[0]);
             s->rsp[1] = s->rsp[2] = s->rsp[3] = 0;
         } else {
-            s->rsp[0] = RWORD(12);
-            s->rsp[1] = RWORD(8);
-            s->rsp[2] = RWORD(4);
-            s->rsp[3] = RWORD(0);
+            s->rsp[0] = ldl_be_p(&rsp[12]);
+            s->rsp[1] = ldl_be_p(&rsp[8]);
+            s->rsp[2] = ldl_be_p(&rsp[4]);
+            s->rsp[3] = ldl_be_p(&rsp[0]);
         }
-#undef RWORD
     }
     /* We never really delay commands, so if this was a 'busywait' command
      * then we've completed it now and can raise the interrupt.
diff --git a/hw/sd/milkymist-memcard.c b/hw/sd/milkymist-memcard.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/sd/milkymist-memcard.c
+++ b/hw/sd/milkymist-memcard.c
@@ -XXX,XX +XXX,XX @@ static void memcard_sd_command(MilkymistMemcardState *s)
     SDRequest req;
 
     req.cmd = s->command[0] & 0x3f;
-    req.arg = (s->command[1] << 24) | (s->command[2] << 16)
-              | (s->command[3] << 8) | s->command[4];
+    req.arg = ldl_be_p(s->command + 1);
     req.crc = s->command[5];
 
     s->response[0] = req.cmd;
diff --git a/hw/sd/omap_mmc.c b/hw/sd/omap_mmc.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/sd/omap_mmc.c
+++ b/hw/sd/omap_mmc.c
@@ -XXX,XX +XXX,XX @@ static void omap_mmc_command(struct omap_mmc_s *host, int cmd, int dir,
                 CID_CSD_OVERWRITE;
         if (host->sdio & (1 << 13))
             mask |= AKE_SEQ_ERROR;
-        rspstatus = (response[0] << 24) | (response[1] << 16) |
-                (response[2] << 8) | (response[3] << 0);
+        rspstatus = ldl_be_p(response);
         break;
 
     case sd_r2:
@@ -XXX,XX +XXX,XX @@ static void omap_mmc_command(struct omap_mmc_s *host, int cmd, int dir,
         }
         rsplen = 4;
 
-        rspstatus = (response[0] << 24) | (response[1] << 16) |
-                (response[2] << 8) | (response[3] << 0);
+        rspstatus = ldl_be_p(response);
         if (rspstatus & 0x80000000)
             host->status &= 0xe000;
         else
diff --git a/hw/sd/pl181.c b/hw/sd/pl181.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/sd/pl181.c
+++ b/hw/sd/pl181.c
@@ -XXX,XX +XXX,XX @@ static void pl181_send_command(PL181State *s)
     if (rlen < 0)
         goto error;
     if (s->cmd & PL181_CMD_RESPONSE) {
-#define RWORD(n) (((uint32_t)response[n] << 24) | (response[n + 1] << 16) \
-                  | (response[n + 2] << 8) | response[n + 3])
         if (rlen == 0 || (rlen == 4 && (s->cmd & PL181_CMD_LONGRESP)))
             goto error;
         if (rlen != 4 && rlen != 16)
             goto error;
-        s->response[0] = RWORD(0);
+        s->response[0] = ldl_be_p(&response[0]);
         if (rlen == 4) {
             s->response[1] = s->response[2] = s->response[3] = 0;
         } else {
-            s->response[1] = RWORD(4);
-            s->response[2] = RWORD(8);
-            s->response[3] = RWORD(12) & ~1;
+            s->response[1] = ldl_be_p(&response[4]);
+            s->response[2] = ldl_be_p(&response[8]);
+            s->response[3] = ldl_be_p(&response[12]) & ~1;
         }
         DPRINTF("Response received\n");
         s->status |= PL181_STATUS_CMDRESPEND;
-#undef RWORD
     } else {
         DPRINTF("Command sent\n");
         s->status |= PL181_STATUS_CMDSENT;
diff --git a/hw/sd/sdhci.c b/hw/sd/sdhci.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/sd/sdhci.c
+++ b/hw/sd/sdhci.c
@@ -XXX,XX +XXX,XX @@ static void sdhci_send_command(SDHCIState *s)
 
     if (s->cmdreg & SDHC_CMD_RESPONSE) {
         if (rlen == 4) {
-            s->rspreg[0] = (response[0] << 24) | (response[1] << 16) |
-                           (response[2] << 8)  |  response[3];
+            s->rspreg[0] = ldl_be_p(response);
             s->rspreg[1] = s->rspreg[2] = s->rspreg[3] = 0;
             trace_sdhci_response4(s->rspreg[0]);
         } else if (rlen == 16) {
-            s->rspreg[0] = (response[11] << 24) | (response[12] << 16) |
-                           (response[13] << 8) |  response[14];
-            s->rspreg[1] = (response[7] << 24) | (response[8] << 16) |
-                           (response[9] << 8)  |  response[10];
-            s->rspreg[2] = (response[3] << 24) | (response[4] << 16) |
-                           (response[5] << 8)  |  response[6];
+            s->rspreg[0] = ldl_be_p(&response[11]);
+            s->rspreg[1] = ldl_be_p(&response[7]);
+            s->rspreg[2] = ldl_be_p(&response[3]);
             s->rspreg[3] = (response[0] << 16) | (response[1] << 8) |
                             response[2];
             trace_sdhci_response16(s->rspreg[3], s->rspreg[2],
@@ -XXX,XX +XXX,XX @@ static void sdhci_end_transfer(SDHCIState *s)
         trace_sdhci_end_transfer(request.cmd, request.arg);
         sdbus_do_command(&s->sdbus, &request, response);
         /* Auto CMD12 response goes to the upper Response register */
-        s->rspreg[3] = (response[0] << 24) | (response[1] << 16) |
-                (response[2] << 8) | response[3];
+        s->rspreg[3] = ldl_be_p(response);
     }
 
     s->prnsts &= ~(SDHC_DOING_READ | SDHC_DOING_WRITE |
diff --git a/hw/sd/ssi-sd.c b/hw/sd/ssi-sd.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/sd/ssi-sd.c
+++ b/hw/sd/ssi-sd.c
@@ -XXX,XX +XXX,XX @@ static uint32_t ssi_sd_transfer(SSISlave *dev, uint32_t val)
             uint8_t longresp[16];
             /* FIXME: Check CRC.  */
             request.cmd = s->cmd;
-            request.arg = (s->cmdarg[0] << 24) | (s->cmdarg[1] << 16)
-                           | (s->cmdarg[2] << 8) | s->cmdarg[3];
+            request.arg = ldl_be_p(s->cmdarg);
             DPRINTF("CMD%d arg 0x%08x\n", s->cmd, request.arg);
             s->arglen = sdbus_do_command(&s->sdbus, &request, longresp);
             if (s->arglen <= 0) {
@@ -XXX,XX +XXX,XX @@ static uint32_t ssi_sd_transfer(SSISlave *dev, uint32_t val)
                 /* CMD13 returns a 2-byte statuse work. Other commands
                    only return the first byte.  */
                 s->arglen = (s->cmd == 13) ? 2 : 1;
-                cardstatus = (longresp[0] << 24) | (longresp[1] << 16)
-                             | (longresp[2] << 8) | longresp[3];
+                cardstatus = ldl_be_p(longresp);
                 status = 0;
                 if (((cardstatus >> 9) & 0xf) < 4)
                     status |= SSI_SDR_IDLE;
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

We already check for the same condition within the normal integer
sdiv and sdiv64 helpers.  Use a slightly different formation that
does not require deducing the expression type.

Fixes: f97cfd596ed
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20180629001538.11415-2-richard.henderson@linaro.org
[PMM: reworded a comment]
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/sve_helper.c | 20 +++++++++++++++-----
 1 file changed, 15 insertions(+), 5 deletions(-)

diff --git a/target/arm/sve_helper.c b/target/arm/sve_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/sve_helper.c
+++ b/target/arm/sve_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(NAME)(void *vd, void *vn, void *vm, void *vg, uint32_t desc) \
 #define DO_MIN(N, M)  ((N) >= (M) ? (M) : (N))
 #define DO_ABD(N, M)  ((N) >= (M) ? (N) - (M) : (M) - (N))
 #define DO_MUL(N, M)  (N * M)
-#define DO_DIV(N, M)  (M ? N / M : 0)
+
+
+/*
+ * We must avoid the C undefined behaviour cases: division by
+ * zero and signed division of INT_MIN by -1. Both of these
+ * have architecturally defined required results for Arm.
+ * We special case all signed divisions by -1 to avoid having
+ * to deduce the minimum integer for the type involved.
+ */
+#define DO_SDIV(N, M) (unlikely(M == 0) ? 0 : unlikely(M == -1) ? -N : N / M)
+#define DO_UDIV(N, M) (unlikely(M == 0) ? 0 : N / M)
 
 DO_ZPZZ(sve_and_zpzz_b, uint8_t, H1, DO_AND)
 DO_ZPZZ(sve_and_zpzz_h, uint16_t, H1_2, DO_AND)
@@ -XXX,XX +XXX,XX @@ DO_ZPZZ(sve_umulh_zpzz_h, uint16_t, H1_2, do_mulh_h)
 DO_ZPZZ(sve_umulh_zpzz_s, uint32_t, H1_4, do_mulh_s)
 DO_ZPZZ_D(sve_umulh_zpzz_d, uint64_t, do_umulh_d)
 
-DO_ZPZZ(sve_sdiv_zpzz_s, int32_t, H1_4, DO_DIV)
-DO_ZPZZ_D(sve_sdiv_zpzz_d, int64_t, DO_DIV)
+DO_ZPZZ(sve_sdiv_zpzz_s, int32_t, H1_4, DO_SDIV)
+DO_ZPZZ_D(sve_sdiv_zpzz_d, int64_t, DO_SDIV)
 
-DO_ZPZZ(sve_udiv_zpzz_s, uint32_t, H1_4, DO_DIV)
-DO_ZPZZ_D(sve_udiv_zpzz_d, uint64_t, DO_DIV)
+DO_ZPZZ(sve_udiv_zpzz_s, uint32_t, H1_4, DO_UDIV)
+DO_ZPZZ_D(sve_udiv_zpzz_d, uint64_t, DO_UDIV)
 
 /* Note that all bits of the shift are significant
    and not modulo the element size.  */
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

Leave ARM_CP_SVE, removing ARM_CP_FPU; the sve_access_check
produced by the flag already includes fp_access_check.  If
we also check ARM_CP_FPU the double fp_access_check asserts.

Reported-by: Laurent Desnogues <laurent.desnogues@gmail.com>
Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Laurent Desnogues <laurent.desnogues@gmail.com>
Message-id: 20180629001538.11415-3-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/helper.c        | 8 ++++----
 target/arm/translate-a64.c | 5 ++---
 2 files changed, 6 insertions(+), 7 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void zcr_write(CPUARMState *env, const ARMCPRegInfo *ri,
 static const ARMCPRegInfo zcr_el1_reginfo = {
     .name = "ZCR_EL1", .state = ARM_CP_STATE_AA64,
     .opc0 = 3, .opc1 = 0, .crn = 1, .crm = 2, .opc2 = 0,
-    .access = PL1_RW, .type = ARM_CP_SVE | ARM_CP_FPU,
+    .access = PL1_RW, .type = ARM_CP_SVE,
     .fieldoffset = offsetof(CPUARMState, vfp.zcr_el[1]),
     .writefn = zcr_write, .raw_writefn = raw_write
 };
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo zcr_el1_reginfo = {
 static const ARMCPRegInfo zcr_el2_reginfo = {
     .name = "ZCR_EL2", .state = ARM_CP_STATE_AA64,
     .opc0 = 3, .opc1 = 4, .crn = 1, .crm = 2, .opc2 = 0,
-    .access = PL2_RW, .type = ARM_CP_SVE | ARM_CP_FPU,
+    .access = PL2_RW, .type = ARM_CP_SVE,
     .fieldoffset = offsetof(CPUARMState, vfp.zcr_el[2]),
     .writefn = zcr_write, .raw_writefn = raw_write
 };
@@ -XXX,XX +XXX,XX @@ static const ARMCPRegInfo zcr_el2_reginfo = {
 static const ARMCPRegInfo zcr_no_el2_reginfo = {
     .name = "ZCR_EL2", .state = ARM_CP_STATE_AA64,
     .opc0 = 3, .opc1 = 4, .crn = 1, .crm = 2, .opc2 = 0,
-    .access = PL2_RW, .type = ARM_CP_SVE | ARM_CP_FPU,
+    .access = PL2_RW, .type = ARM_CP_SVE,
     .readfn = arm_cp_read_zero, .writefn = arm_cp_write_ignore
 };
 
 static const ARMCPRegInfo zcr_el3_reginfo = {
     .name = "ZCR_EL3", .state = ARM_CP_STATE_AA64,
     .opc0 = 3, .opc1 = 6, .crn = 1, .crm = 2, .opc2 = 0,
-    .access = PL3_RW, .type = ARM_CP_SVE | ARM_CP_FPU,
+    .access = PL3_RW, .type = ARM_CP_SVE,
     .fieldoffset = offsetof(CPUARMState, vfp.zcr_el[3]),
     .writefn = zcr_write, .raw_writefn = raw_write
 };
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -XXX,XX +XXX,XX @@ static void handle_sys(DisasContext *s, uint32_t insn, bool isread,
     default:
         break;
     }
-    if ((ri->type & ARM_CP_SVE) && !sve_access_check(s)) {
-        return;
-    }
     if ((ri->type & ARM_CP_FPU) && !fp_access_check(s)) {
         return;
+    } else if ((ri->type & ARM_CP_SVE) && !sve_access_check(s)) {
+        return;
     }
 
     if ((tb_cflags(s->base.tb) & CF_USE_ICOUNT) && (ri->type & ARM_CP_IO)) {
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

There is no need to re-set these 9 features already
implied by the call to aarch64_a57_initfn.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20180629001538.11415-4-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu64.c | 9 ---------
 1 file changed, 9 deletions(-)

diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu64.c
+++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_max_initfn(Object *obj)
          * whereas the architecture requires them to be present in both if
          * present in either.
          */
-        set_feature(&cpu->env, ARM_FEATURE_V8);
-        set_feature(&cpu->env, ARM_FEATURE_VFP4);
-        set_feature(&cpu->env, ARM_FEATURE_NEON);
-        set_feature(&cpu->env, ARM_FEATURE_AARCH64);
-        set_feature(&cpu->env, ARM_FEATURE_V8_AES);
-        set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
-        set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
         set_feature(&cpu->env, ARM_FEATURE_V8_SHA512);
         set_feature(&cpu->env, ARM_FEATURE_V8_SHA3);
         set_feature(&cpu->env, ARM_FEATURE_V8_SM3);
         set_feature(&cpu->env, ARM_FEATURE_V8_SM4);
-        set_feature(&cpu->env, ARM_FEATURE_V8_PMULL);
-        set_feature(&cpu->env, ARM_FEATURE_CRC);
         set_feature(&cpu->env, ARM_FEATURE_V8_ATOMICS);
         set_feature(&cpu->env, ARM_FEATURE_V8_RDM);
         set_feature(&cpu->env, ARM_FEATURE_V8_DOTPROD);
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

There is no need to re-set these 3 features already
implied by the call to aarch64_a15_initfn.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20180629001538.11415-5-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.c | 3 ---
 1 file changed, 3 deletions(-)

diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_max_initfn(Object *obj)
          * since we don't correctly set the ID registers to advertise them,
          */
         set_feature(&cpu->env, ARM_FEATURE_V8);
-        set_feature(&cpu->env, ARM_FEATURE_VFP4);
-        set_feature(&cpu->env, ARM_FEATURE_NEON);
-        set_feature(&cpu->env, ARM_FEATURE_THUMB2EE);
         set_feature(&cpu->env, ARM_FEATURE_V8_AES);
         set_feature(&cpu->env, ARM_FEATURE_V8_SHA1);
         set_feature(&cpu->env, ARM_FEATURE_V8_SHA256);
-- 
2.17.1

From: Richard Henderson <richard.henderson@linaro.org>

This register was added to aa32 state by ARMv8.2.

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20180629001538.11415-6-richard.henderson@linaro.org
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 target/arm/cpu.h    | 1 +
 target/arm/cpu.c    | 4 ++++
 target/arm/cpu64.c  | 2 ++
 target/arm/helper.c | 5 ++---
 4 files changed, 9 insertions(+), 3 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ struct ARMCPU {
     uint32_t id_isar3;
     uint32_t id_isar4;
     uint32_t id_isar5;
+    uint32_t id_isar6;
     uint64_t id_aa64pfr0;
     uint64_t id_aa64pfr1;
     uint64_t id_aa64dfr0;
diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void cortex_m3_initfn(Object *obj)
     cpu->id_isar3 = 0x01111110;
     cpu->id_isar4 = 0x01310102;
     cpu->id_isar5 = 0x00000000;
+    cpu->id_isar6 = 0x00000000;
 }
 
 static void cortex_m4_initfn(Object *obj)
@@ -XXX,XX +XXX,XX @@ static void cortex_m4_initfn(Object *obj)
     cpu->id_isar3 = 0x01111110;
     cpu->id_isar4 = 0x01310102;
     cpu->id_isar5 = 0x00000000;
+    cpu->id_isar6 = 0x00000000;
 }
 
 static void cortex_m33_initfn(Object *obj)
@@ -XXX,XX +XXX,XX @@ static void cortex_m33_initfn(Object *obj)
     cpu->id_isar3 = 0x01111131;
     cpu->id_isar4 = 0x01310132;
     cpu->id_isar5 = 0x00000000;
+    cpu->id_isar6 = 0x00000000;
     cpu->clidr = 0x00000000;
     cpu->ctr = 0x8000c000;
 }
@@ -XXX,XX +XXX,XX @@ static void cortex_r5_initfn(Object *obj)
     cpu->id_isar3 = 0x01112131;
     cpu->id_isar4 = 0x0010142;
     cpu->id_isar5 = 0x0;
+    cpu->id_isar6 = 0x0;
     cpu->mp_is_up = true;
     cpu->pmsav7_dregion = 16;
     define_arm_cp_regs(cpu, cortexr5_cp_reginfo);
diff --git a/target/arm/cpu64.c b/target/arm/cpu64.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu64.c
+++ b/target/arm/cpu64.c
@@ -XXX,XX +XXX,XX @@ static void aarch64_a57_initfn(Object *obj)
     cpu->id_isar3 = 0x01112131;
     cpu->id_isar4 = 0x00011142;
     cpu->id_isar5 = 0x00011121;
+    cpu->id_isar6 = 0;
     cpu->id_aa64pfr0 = 0x00002222;
     cpu->id_aa64dfr0 = 0x10305106;
     cpu->pmceid0 = 0x00000000;
@@ -XXX,XX +XXX,XX @@ static void aarch64_a53_initfn(Object *obj)
     cpu->id_isar3 = 0x01112131;
     cpu->id_isar4 = 0x00011142;
     cpu->id_isar5 = 0x00011121;
+    cpu->id_isar6 = 0;
     cpu->id_aa64pfr0 = 0x00002222;
     cpu->id_aa64dfr0 = 0x10305106;
     cpu->id_aa64isar0 = 0x00011120;
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void register_cp_regs_for_features(ARMCPU *cpu)
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 6,
               .access = PL1_R, .type = ARM_CP_CONST,
               .resetvalue = cpu->id_mmfr4 },
-            /* 7 is as yet unallocated and must RAZ */
-            { .name = "ID_ISAR7_RESERVED", .state = ARM_CP_STATE_BOTH,
+            { .name = "ID_ISAR6", .state = ARM_CP_STATE_BOTH,
               .opc0 = 3, .opc1 = 0, .crn = 0, .crm = 2, .opc2 = 7,
               .access = PL1_R, .type = ARM_CP_CONST,
-              .resetvalue = 0 },
+              .resetvalue = cpu->id_isar6 },
             REGINFO_SENTINEL
         };
         define_arm_cp_regs(cpu, v6_idregs);
-- 
2.17.1

First pullreq for arm of the 4.1 series, since I'm back from
holiday now. This is mostly my M-profile FPU series and Philippe's
devices.h cleanup. I have a pile of other patchsets to work through
in my to-review folder, but 42 patches is definitely quite
big enough to send now...

thanks
-- PMM

The following changes since commit 413a99a92c13ec408dcf2adaa87918dc81e890c8:

Add Nios II semihosting support. (2019-04-29 16:09:51 +0100)

are available in the Git repository at:

https://git.linaro.org/people/pmaydell/qemu-arm.git tags/pull-target-arm-20190429

for you to fetch changes up to 437cc27ddfded3bbab6afd5ac1761e0e195edba7:

hw/devices: Move SMSC 91C111 declaration into a new header (2019-04-29 17:57:21 +0100)

----------------------------------------------------------------
target-arm queue:
 * remove "bag of random stuff" hw/devices.h header
 * implement FPU for Cortex-M and enable it for Cortex-M4 and -M33
 * hw/dma: Compile the bcm2835_dma device as common object
 * configure: Remove --source-path option
 * hw/ssi/xilinx_spips: Avoid variable length array
 * hw/arm/smmuv3: Remove SMMUNotifierNode

----------------------------------------------------------------
Eric Auger (1):
      hw/arm/smmuv3: Remove SMMUNotifierNode

Peter Maydell (28):
      hw/ssi/xilinx_spips: Avoid variable length array
      configure: Remove --source-path option
      target/arm: Make sure M-profile FPSCR RES0 bits are not settable
      hw/intc/armv7m_nvic: Allow reading of M-profile MVFR* registers
      target/arm: Implement dummy versions of M-profile FP-related registers
      target/arm: Disable most VFP sysregs for M-profile
      target/arm: Honour M-profile FP enable bits
      target/arm: Decode FP instructions for M profile
      target/arm: Clear CONTROL_S.SFPA in SG insn if FPU present
      target/arm: Handle SFPA and FPCA bits in reads and writes of CONTROL
      target/arm/helper: don't return early for STKOF faults during stacking
      target/arm: Handle floating point registers in exception entry
      target/arm: Implement v7m_update_fpccr()
      target/arm: Clear CONTROL.SFPA in BXNS and BLXNS
      target/arm: Clean excReturn bits when tail chaining
      target/arm: Allow for floating point in callee stack integrity check
      target/arm: Handle floating point registers in exception return
      target/arm: Move NS TBFLAG from bit 19 to bit 6
      target/arm: Overlap VECSTRIDE and XSCALE_CPAR TB flags
      target/arm: Set FPCCR.S when executing M-profile floating point insns
      target/arm: Activate M-profile floating point context when FPCCR.ASPEN is set
      target/arm: New helper function arm_v7m_mmu_idx_all()
      target/arm: New function armv7m_nvic_set_pending_lazyfp()
      target/arm: Add lazy-FP-stacking support to v7m_stack_write()
      target/arm: Implement M-profile lazy FP state preservation
      target/arm: Implement VLSTM for v7M CPUs with an FPU
      target/arm: Implement VLLDM for v7M CPUs with an FPU
      target/arm: Enable FPU for Cortex-M4 and Cortex-M33

Philippe Mathieu-Daudé (13):
      hw/dma: Compile the bcm2835_dma device as common object
      hw/arm/aspeed: Use TYPE_TMP105/TYPE_PCA9552 instead of hardcoded string
      hw/arm/nseries: Use TYPE_TMP105 instead of hardcoded string
      hw/display/tc6393xb: Remove unused functions
      hw/devices: Move TC6393XB declarations into a new header
      hw/devices: Move Blizzard declarations into a new header
      hw/devices: Move CBus declarations into a new header
      hw/devices: Move Gamepad declarations into a new header
      hw/devices: Move TI touchscreen declarations into a new header
      hw/devices: Move LAN9118 declarations into a new header
      hw/net/ne2000-isa: Add guards to the header
      hw/net/lan9118: Export TYPE_LAN9118 and use it instead of hardcoded string
      hw/devices: Move SMSC 91C111 declaration into a new header

From: Eric Auger <eric.auger@redhat.com>

The SMMUNotifierNode struct is not necessary and brings extra
complexity so let's remove it. We now directly track the SMMUDevices
which have registered IOMMU MR notifiers.

This is inspired from the same transformation on intel-iommu
done in commit b4a4ba0d68f50f218ee3957b6638dbee32a5eeef
("intel-iommu: remove IntelIOMMUNotifierNode")

Signed-off-by: Eric Auger <eric.auger@redhat.com>
Reviewed-by: Peter Xu <peterx@redhat.com>
Message-id: 20190409160219.19026-1-eric.auger@redhat.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/arm/smmu-common.h |  8 ++------
 hw/arm/smmu-common.c         |  6 +++---
 hw/arm/smmuv3.c              | 28 +++++++---------------------
 3 files changed, 12 insertions(+), 30 deletions(-)

diff --git a/include/hw/arm/smmu-common.h b/include/hw/arm/smmu-common.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/arm/smmu-common.h
+++ b/include/hw/arm/smmu-common.h
@@ -XXX,XX +XXX,XX @@ typedef struct SMMUDevice {
     AddressSpace       as;
     uint32_t           cfg_cache_hits;
     uint32_t           cfg_cache_misses;
+    QLIST_ENTRY(SMMUDevice) next;
 } SMMUDevice;
 
-typedef struct SMMUNotifierNode {
-    SMMUDevice *sdev;
-    QLIST_ENTRY(SMMUNotifierNode) next;
-} SMMUNotifierNode;
-
 typedef struct SMMUPciBus {
     PCIBus       *bus;
     SMMUDevice   *pbdev[0]; /* Parent array is sparse, so dynamically alloc */
@@ -XXX,XX +XXX,XX @@ typedef struct SMMUState {
     GHashTable *iotlb;
     SMMUPciBus *smmu_pcibus_by_bus_num[SMMU_PCI_BUS_MAX];
     PCIBus *pci_bus;
-    QLIST_HEAD(, SMMUNotifierNode) notifiers_list;
+    QLIST_HEAD(, SMMUDevice) devices_with_notifiers;
     uint8_t bus_num;
     PCIBus *primary_bus;
 } SMMUState;
diff --git a/hw/arm/smmu-common.c b/hw/arm/smmu-common.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/smmu-common.c
+++ b/hw/arm/smmu-common.c
@@ -XXX,XX +XXX,XX @@ inline void smmu_inv_notifiers_mr(IOMMUMemoryRegion *mr)
 /* Unmap all notifiers of all mr's */
 void smmu_inv_notifiers_all(SMMUState *s)
 {
-    SMMUNotifierNode *node;
+    SMMUDevice *sdev;
 
-    QLIST_FOREACH(node, &s->notifiers_list, next) {
-        smmu_inv_notifiers_mr(&node->sdev->iommu);
+    QLIST_FOREACH(sdev, &s->devices_with_notifiers, next) {
+        smmu_inv_notifiers_mr(&sdev->iommu);
     }
 }
 
diff --git a/hw/arm/smmuv3.c b/hw/arm/smmuv3.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/smmuv3.c
+++ b/hw/arm/smmuv3.c
@@ -XXX,XX +XXX,XX @@ static void smmuv3_notify_iova(IOMMUMemoryRegion *mr,
 /* invalidate an asid/iova tuple in all mr's */
 static void smmuv3_inv_notifiers_iova(SMMUState *s, int asid, dma_addr_t iova)
 {
-    SMMUNotifierNode *node;
+    SMMUDevice *sdev;
 
-    QLIST_FOREACH(node, &s->notifiers_list, next) {
-        IOMMUMemoryRegion *mr = &node->sdev->iommu;
+    QLIST_FOREACH(sdev, &s->devices_with_notifiers, next) {
+        IOMMUMemoryRegion *mr = &sdev->iommu;
         IOMMUNotifier *n;
 
         trace_smmuv3_inv_notifiers_iova(mr->parent_obj.name, asid, iova);
@@ -XXX,XX +XXX,XX @@ static void smmuv3_notify_flag_changed(IOMMUMemoryRegion *iommu,
     SMMUDevice *sdev = container_of(iommu, SMMUDevice, iommu);
     SMMUv3State *s3 = sdev->smmu;
     SMMUState *s = &(s3->smmu_state);
-    SMMUNotifierNode *node = NULL;
-    SMMUNotifierNode *next_node = NULL;
 
     if (new & IOMMU_NOTIFIER_MAP) {
         int bus_num = pci_bus_num(sdev->bus);
@@ -XXX,XX +XXX,XX @@ static void smmuv3_notify_flag_changed(IOMMUMemoryRegion *iommu,
 
     if (old == IOMMU_NOTIFIER_NONE) {
         trace_smmuv3_notify_flag_add(iommu->parent_obj.name);
-        node = g_malloc0(sizeof(*node));
-        node->sdev = sdev;
-        QLIST_INSERT_HEAD(&s->notifiers_list, node, next);
-        return;
-    }
-
-    /* update notifier node with new flags */
-    QLIST_FOREACH_SAFE(node, &s->notifiers_list, next, next_node) {
-        if (node->sdev == sdev) {
-            if (new == IOMMU_NOTIFIER_NONE) {
-                trace_smmuv3_notify_flag_del(iommu->parent_obj.name);
-                QLIST_REMOVE(node, next);
-                g_free(node);
-            }
-            return;
-        }
+        QLIST_INSERT_HEAD(&s->devices_with_notifiers, sdev, next);
+    } else if (new == IOMMU_NOTIFIER_NONE) {
+        trace_smmuv3_notify_flag_del(iommu->parent_obj.name);
+        QLIST_REMOVE(sdev, next);
     }
 }
 
-- 
2.20.1

In the stripe8() function we use a variable length array; however
we know that the maximum length required is MAX_NUM_BUSSES. Use
a fixed-length array and an assert instead.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Philippe Mathieu-Daudé <f4bug@amsat.org>
Reviewed-by: Francisco Iglesias <frasse.iglesias@gmail.com>
Reviewed-by: Alistair Francis <alistair.francis@wdc.com>
Reviewed-by: Stefano Garzarella <sgarzare@redhat.com>
Message-id: 20190328152635.2794-1-peter.maydell@linaro.org
---
 hw/ssi/xilinx_spips.c | 6 ++++--
 1 file changed, 4 insertions(+), 2 deletions(-)

diff --git a/hw/ssi/xilinx_spips.c b/hw/ssi/xilinx_spips.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/ssi/xilinx_spips.c
+++ b/hw/ssi/xilinx_spips.c
@@ -XXX,XX +XXX,XX @@ static void xlnx_zynqmp_qspips_reset(DeviceState *d)
 
 static inline void stripe8(uint8_t *x, int num, bool dir)
 {
-    uint8_t r[num];
-    memset(r, 0, sizeof(uint8_t) * num);
+    uint8_t r[MAX_NUM_BUSSES];
     int idx[2] = {0, 0};
     int bit[2] = {0, 7};
     int d = dir;
 
+    assert(num <= MAX_NUM_BUSSES);
+    memset(r, 0, sizeof(uint8_t) * num);
+
     for (idx[0] = 0; idx[0] < num; ++idx[0]) {
         for (bit[0] = 7; bit[0] >= 0; bit[0]--) {
             r[idx[!d]] |= x[idx[d]] & 1 << bit[d] ? 1 << bit[!d] : 0;
-- 
2.20.1

Normally configure identifies the source path by looking
at the location where the configure script itself exists.
We also provide a --source-path option which lets the user
manually override this.

There isn't really an obvious use case for the --source-path
option, and in commit 927128222b0a91f56c13a in 2017 we
accidentally added some logic that looks at $source_path
before the command line option that overrides it has been
processed.

The fact that nobody complained suggests that there isn't
any use of this option and we aren't testing it either;
remove it. This allows us to move the "make $source_path
absolute" logic up so that there is no window in the script
where $source_path is set but not yet absolute.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Daniel P. Berrangé <berrange@redhat.com>
Message-id: 20190318134019.23729-1-peter.maydell@linaro.org
---
 configure | 10 ++--------
 1 file changed, 2 insertions(+), 8 deletions(-)

diff --git a/configure b/configure
index XXXXXXX..XXXXXXX 100755
--- a/configure
+++ b/configure
@@ -XXX,XX +XXX,XX @@ ld_has() {
 
 # default parameters
 source_path=$(dirname "$0")
+# make source path absolute
+source_path=$(cd "$source_path"; pwd)
 cpu=""
 iasl="iasl"
 interp_prefix="/usr/gnemul/qemu-%M"
@@ -XXX,XX +XXX,XX @@ for opt do
   ;;
   --cxx=*) CXX="$optarg"
   ;;
-  --source-path=*) source_path="$optarg"
-  ;;
   --cpu=*) cpu="$optarg"
   ;;
   --extra-cflags=*) QEMU_CFLAGS="$QEMU_CFLAGS $optarg"
@@ -XXX,XX +XXX,XX @@ if test "$debug_info" = "yes"; then
     LDFLAGS="-g $LDFLAGS"
 fi
 
-# make source path absolute
-source_path=$(cd "$source_path"; pwd)
-
 # running configure in the source tree?
 # we know that's the case if configure is there.
 if test -f "./configure"; then
@@ -XXX,XX +XXX,XX @@ for opt do
   ;;
   --interp-prefix=*) interp_prefix="$optarg"
   ;;
-  --source-path=*)
-  ;;
   --cross-prefix=*)
   ;;
   --cc=*)
@@ -XXX,XX +XXX,XX @@ $(echo Available targets: $default_target_list | \
   --target-list-exclude=LIST exclude a set of targets from the default target-list
 
 Advanced options (experts only):
-  --source-path=PATH       path of source code [$source_path]
   --cross-prefix=PREFIX    use PREFIX for compile tools [$cross_prefix]
   --cc=CC                  use C compiler CC [$cc]
   --iasl=IASL              use ACPI compiler IASL [$iasl]
-- 
2.20.1

Enforce that for M-profile various FPSCR bits which are RES0 there
but have defined meanings on A-profile are never settable. This
ensures that M-profile code can't enable the A-profile behaviour
(notably vector length/stride handling) by accident.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-2-peter.maydell@linaro.org
---
 target/arm/vfp_helper.c | 8 ++++++++
 1 file changed, 8 insertions(+)

diff --git a/target/arm/vfp_helper.c b/target/arm/vfp_helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/vfp_helper.c
+++ b/target/arm/vfp_helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(vfp_set_fpscr)(CPUARMState *env, uint32_t val)
         val &= ~FPCR_FZ16;
     }
 
+    if (arm_feature(env, ARM_FEATURE_M)) {
+        /*
+         * M profile FPSCR is RES0 for the QC, STRIDE, FZ16, LEN bits
+         * and also for the trapped-exception-handling bits IxE.
+         */
+        val &= 0xf7c0009f;
+    }
+
     /*
      * We don't implement trapped exception handling, so the
      * trap enable bits, IDE|IXE|UFE|OFE|DZE|IOE are all RAZ/WI (not RES0!)
-- 
2.20.1

For M-profile the MVFR* ID registers are memory mapped, in the
range we implement via the NVIC. Allow them to be read.
(If the CPU has no FPU, these registers are defined to be RAZ.)

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-3-peter.maydell@linaro.org
---
 hw/intc/armv7m_nvic.c | 6 ++++++
 1 file changed, 6 insertions(+)

diff --git a/hw/intc/armv7m_nvic.c b/hw/intc/armv7m_nvic.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/intc/armv7m_nvic.c
+++ b/hw/intc/armv7m_nvic.c
@@ -XXX,XX +XXX,XX @@ static uint32_t nvic_readl(NVICState *s, uint32_t offset, MemTxAttrs attrs)
             return 0;
         }
         return cpu->env.v7m.sfar;
+    case 0xf40: /* MVFR0 */
+        return cpu->isar.mvfr0;
+    case 0xf44: /* MVFR1 */
+        return cpu->isar.mvfr1;
+    case 0xf48: /* MVFR2 */
+        return cpu->isar.mvfr2;
     default:
     bad_offset:
         qemu_log_mask(LOG_GUEST_ERROR, "NVIC: Bad read offset 0x%x\n", offset);
-- 
2.20.1

The M-profile floating point support has three associated config
registers: FPCAR, FPCCR and FPDSCR. It also makes the registers
CPACR and NSACR have behaviour other than reads-as-zero.
Add support for all of these as simple reads-as-written registers.
We will hook up actual functionality later.

The main complexity here is handling the FPCCR register, which
has a mix of banked and unbanked bits.

Note that we don't share storage with the A-profile
cpu->cp15.nsacr and cpu->cp15.cpacr_el1, though the behaviour
is quite similar, for two reasons:
 * the M profile CPACR is banked between security states
 * it preserves the invariant that M profile uses no state
   inside the cp15 substruct

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-4-peter.maydell@linaro.org
---
 target/arm/cpu.h      |  34 ++++++++++++
 hw/intc/armv7m_nvic.c | 125 ++++++++++++++++++++++++++++++++++++++++++
 target/arm/cpu.c      |   5 ++
 target/arm/machine.c  |  16 ++++++
 4 files changed, 180 insertions(+)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ typedef struct CPUARMState {
         uint32_t scr[M_REG_NUM_BANKS];
         uint32_t msplim[M_REG_NUM_BANKS];
         uint32_t psplim[M_REG_NUM_BANKS];
+        uint32_t fpcar[M_REG_NUM_BANKS];
+        uint32_t fpccr[M_REG_NUM_BANKS];
+        uint32_t fpdscr[M_REG_NUM_BANKS];
+        uint32_t cpacr[M_REG_NUM_BANKS];
+        uint32_t nsacr;
     } v7m;
 
     /* Information associated with an exception about to be taken:
@@ -XXX,XX +XXX,XX @@ FIELD(V7M_CSSELR, LEVEL, 1, 3)
  */
 FIELD(V7M_CSSELR, INDEX, 0, 4)
 
+/* v7M FPCCR bits */
+FIELD(V7M_FPCCR, LSPACT, 0, 1)
+FIELD(V7M_FPCCR, USER, 1, 1)
+FIELD(V7M_FPCCR, S, 2, 1)
+FIELD(V7M_FPCCR, THREAD, 3, 1)
+FIELD(V7M_FPCCR, HFRDY, 4, 1)
+FIELD(V7M_FPCCR, MMRDY, 5, 1)
+FIELD(V7M_FPCCR, BFRDY, 6, 1)
+FIELD(V7M_FPCCR, SFRDY, 7, 1)
+FIELD(V7M_FPCCR, MONRDY, 8, 1)
+FIELD(V7M_FPCCR, SPLIMVIOL, 9, 1)
+FIELD(V7M_FPCCR, UFRDY, 10, 1)
+FIELD(V7M_FPCCR, RES0, 11, 15)
+FIELD(V7M_FPCCR, TS, 26, 1)
+FIELD(V7M_FPCCR, CLRONRETS, 27, 1)
+FIELD(V7M_FPCCR, CLRONRET, 28, 1)
+FIELD(V7M_FPCCR, LSPENS, 29, 1)
+FIELD(V7M_FPCCR, LSPEN, 30, 1)
+FIELD(V7M_FPCCR, ASPEN, 31, 1)
+/* These bits are banked. Others are non-banked and live in the M_REG_S bank */
+#define R_V7M_FPCCR_BANKED_MASK                 \
+    (R_V7M_FPCCR_LSPACT_MASK |                  \
+     R_V7M_FPCCR_USER_MASK |                    \
+     R_V7M_FPCCR_THREAD_MASK |                  \
+     R_V7M_FPCCR_MMRDY_MASK |                   \
+     R_V7M_FPCCR_SPLIMVIOL_MASK |               \
+     R_V7M_FPCCR_UFRDY_MASK |                   \
+     R_V7M_FPCCR_ASPEN_MASK)
+
 /*
  * System register ID fields.
  */
diff --git a/hw/intc/armv7m_nvic.c b/hw/intc/armv7m_nvic.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/intc/armv7m_nvic.c
+++ b/hw/intc/armv7m_nvic.c
@@ -XXX,XX +XXX,XX @@ static uint32_t nvic_readl(NVICState *s, uint32_t offset, MemTxAttrs attrs)
     }
     case 0xd84: /* CSSELR */
         return cpu->env.v7m.csselr[attrs.secure];
+    case 0xd88: /* CPACR */
+        if (!arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
+            return 0;
+        }
+        return cpu->env.v7m.cpacr[attrs.secure];
+    case 0xd8c: /* NSACR */
+        if (!attrs.secure || !arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
+            return 0;
+        }
+        return cpu->env.v7m.nsacr;
     /* TODO: Implement debug registers.  */
     case 0xd90: /* MPU_TYPE */
         /* Unified MPU; if the MPU is not present this value is zero */
@@ -XXX,XX +XXX,XX @@ static uint32_t nvic_readl(NVICState *s, uint32_t offset, MemTxAttrs attrs)
             return 0;
         }
         return cpu->env.v7m.sfar;
+    case 0xf34: /* FPCCR */
+        if (!arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
+            return 0;
+        }
+        if (attrs.secure) {
+            return cpu->env.v7m.fpccr[M_REG_S];
+        } else {
+            /*
+             * NS can read LSPEN, CLRONRET and MONRDY. It can read
+             * BFRDY and HFRDY if AIRCR.BFHFNMINS != 0;
+             * other non-banked bits RAZ.
+             * TODO: MONRDY should RAZ/WI if DEMCR.SDME is set.
+             */
+            uint32_t value = cpu->env.v7m.fpccr[M_REG_S];
+            uint32_t mask = R_V7M_FPCCR_LSPEN_MASK |
+                R_V7M_FPCCR_CLRONRET_MASK |
+                R_V7M_FPCCR_MONRDY_MASK;
+
+            if (s->cpu->env.v7m.aircr & R_V7M_AIRCR_BFHFNMINS_MASK) {
+                mask |= R_V7M_FPCCR_BFRDY_MASK | R_V7M_FPCCR_HFRDY_MASK;
+            }
+
+            value &= mask;
+
+            value |= cpu->env.v7m.fpccr[M_REG_NS];
+            return value;
+        }
+    case 0xf38: /* FPCAR */
+        if (!arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
+            return 0;
+        }
+        return cpu->env.v7m.fpcar[attrs.secure];
+    case 0xf3c: /* FPDSCR */
+        if (!arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
+            return 0;
+        }
+        return cpu->env.v7m.fpdscr[attrs.secure];
     case 0xf40: /* MVFR0 */
         return cpu->isar.mvfr0;
     case 0xf44: /* MVFR1 */
@@ -XXX,XX +XXX,XX @@ static void nvic_writel(NVICState *s, uint32_t offset, uint32_t value,
             cpu->env.v7m.csselr[attrs.secure] = value & R_V7M_CSSELR_INDEX_MASK;
         }
         break;
+    case 0xd88: /* CPACR */
+        if (arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
+            /* We implement only the Floating Point extension's CP10/CP11 */
+            cpu->env.v7m.cpacr[attrs.secure] = value & (0xf << 20);
+        }
+        break;
+    case 0xd8c: /* NSACR */
+        if (attrs.secure && arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
+            /* We implement only the Floating Point extension's CP10/CP11 */
+            cpu->env.v7m.nsacr = value & (3 << 10);
+        }
+        break;
     case 0xd90: /* MPU_TYPE */
         return; /* RO */
     case 0xd94: /* MPU_CTRL */
@@ -XXX,XX +XXX,XX @@ static void nvic_writel(NVICState *s, uint32_t offset, uint32_t value,
         }
         break;
     }
+    case 0xf34: /* FPCCR */
+        if (arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
+            /* Not all bits here are banked. */
+            uint32_t fpccr_s;
+
+            if (!arm_feature(&cpu->env, ARM_FEATURE_V8)) {
+                /* Don't allow setting of bits not present in v7M */
+                value &= (R_V7M_FPCCR_LSPACT_MASK |
+                          R_V7M_FPCCR_USER_MASK |
+                          R_V7M_FPCCR_THREAD_MASK |
+                          R_V7M_FPCCR_HFRDY_MASK |
+                          R_V7M_FPCCR_MMRDY_MASK |
+                          R_V7M_FPCCR_BFRDY_MASK |
+                          R_V7M_FPCCR_MONRDY_MASK |
+                          R_V7M_FPCCR_LSPEN_MASK |
+                          R_V7M_FPCCR_ASPEN_MASK);
+            }
+            value &= ~R_V7M_FPCCR_RES0_MASK;
+
+            if (!attrs.secure) {
+                /* Some non-banked bits are configurably writable by NS */
+                fpccr_s = cpu->env.v7m.fpccr[M_REG_S];
+                if (!(fpccr_s & R_V7M_FPCCR_LSPENS_MASK)) {
+                    uint32_t lspen = FIELD_EX32(value, V7M_FPCCR, LSPEN);
+                    fpccr_s = FIELD_DP32(fpccr_s, V7M_FPCCR, LSPEN, lspen);
+                }
+                if (!(fpccr_s & R_V7M_FPCCR_CLRONRETS_MASK)) {
+                    uint32_t cor = FIELD_EX32(value, V7M_FPCCR, CLRONRET);
+                    fpccr_s = FIELD_DP32(fpccr_s, V7M_FPCCR, CLRONRET, cor);
+                }
+                if ((s->cpu->env.v7m.aircr & R_V7M_AIRCR_BFHFNMINS_MASK)) {
+                    uint32_t hfrdy = FIELD_EX32(value, V7M_FPCCR, HFRDY);
+                    uint32_t bfrdy = FIELD_EX32(value, V7M_FPCCR, BFRDY);
+                    fpccr_s = FIELD_DP32(fpccr_s, V7M_FPCCR, HFRDY, hfrdy);
+                    fpccr_s = FIELD_DP32(fpccr_s, V7M_FPCCR, BFRDY, bfrdy);
+                }
+                /* TODO MONRDY should RAZ/WI if DEMCR.SDME is set */
+                {
+                    uint32_t monrdy = FIELD_EX32(value, V7M_FPCCR, MONRDY);
+                    fpccr_s = FIELD_DP32(fpccr_s, V7M_FPCCR, MONRDY, monrdy);
+                }
+
+                /*
+                 * All other non-banked bits are RAZ/WI from NS; write
+                 * just the banked bits to fpccr[M_REG_NS].
+                 */
+                value &= R_V7M_FPCCR_BANKED_MASK;
+                cpu->env.v7m.fpccr[M_REG_NS] = value;
+            } else {
+                fpccr_s = value;
+            }
+            cpu->env.v7m.fpccr[M_REG_S] = fpccr_s;
+        }
+        break;
+    case 0xf38: /* FPCAR */
+        if (arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
+            value &= ~7;
+            cpu->env.v7m.fpcar[attrs.secure] = value;
+        }
+        break;
+    case 0xf3c: /* FPDSCR */
+        if (arm_feature(&cpu->env, ARM_FEATURE_VFP)) {
+            value &= 0x07c00000;
+            cpu->env.v7m.fpdscr[attrs.secure] = value;
+        }
+        break;
     case 0xf50: /* ICIALLU */
     case 0xf58: /* ICIMVAU */
     case 0xf5c: /* DCIMVAC */
diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_reset(CPUState *s)
             env->v7m.ccr[M_REG_S] |= R_V7M_CCR_UNALIGN_TRP_MASK;
         }
 
+        if (arm_feature(env, ARM_FEATURE_VFP)) {
+            env->v7m.fpccr[M_REG_NS] = R_V7M_FPCCR_ASPEN_MASK;
+            env->v7m.fpccr[M_REG_S] = R_V7M_FPCCR_ASPEN_MASK |
+                R_V7M_FPCCR_LSPEN_MASK | R_V7M_FPCCR_S_MASK;
+        }
         /* Unlike A/R profile, M profile defines the reset LR value */
         env->regs[14] = 0xffffffff;
 
diff --git a/target/arm/machine.c b/target/arm/machine.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/machine.c
+++ b/target/arm/machine.c
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_m_v8m = {
     }
 };
 
+static const VMStateDescription vmstate_m_fp = {
+    .name = "cpu/m/fp",
+    .version_id = 1,
+    .minimum_version_id = 1,
+    .needed = vfp_needed,
+    .fields = (VMStateField[]) {
+        VMSTATE_UINT32_ARRAY(env.v7m.fpcar, ARMCPU, M_REG_NUM_BANKS),
+        VMSTATE_UINT32_ARRAY(env.v7m.fpccr, ARMCPU, M_REG_NUM_BANKS),
+        VMSTATE_UINT32_ARRAY(env.v7m.fpdscr, ARMCPU, M_REG_NUM_BANKS),
+        VMSTATE_UINT32_ARRAY(env.v7m.cpacr, ARMCPU, M_REG_NUM_BANKS),
+        VMSTATE_UINT32(env.v7m.nsacr, ARMCPU),
+        VMSTATE_END_OF_LIST()
+    }
+};
+
 static const VMStateDescription vmstate_m = {
     .name = "cpu/m",
     .version_id = 4,
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_m = {
         &vmstate_m_scr,
         &vmstate_m_other_sp,
         &vmstate_m_v8m,
+        &vmstate_m_fp,
         NULL
     }
 };
-- 
2.20.1

The only "system register" that M-profile floating point exposes
via the VMRS/VMRS instructions is FPSCR, and it does not have
the odd special case for rd==15. Add a check to ensure we only
expose FPSCR.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-5-peter.maydell@linaro.org
---
 target/arm/translate.c | 19 +++++++++++++++++--
 1 file changed, 17 insertions(+), 2 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_vfp_insn(DisasContext *s, uint32_t insn)
                     }
                 }
             } else { /* !dp */
+                bool is_sysreg;
+
                 if ((insn & 0x6f) != 0x00)
                     return 1;
                 rn = VFP_SREG_N(insn);
+
+                is_sysreg = extract32(insn, 21, 1);
+
+                if (arm_dc_feature(s, ARM_FEATURE_M)) {
+                    /*
+                     * The only M-profile VFP vmrs/vmsr sysreg is FPSCR.
+                     * Writes to R15 are UNPREDICTABLE; we choose to undef.
+                     */
+                    if (is_sysreg && (rd == 15 || (rn >> 1) != ARM_VFP_FPSCR)) {
+                        return 1;
+                    }
+                }
+
                 if (insn & ARM_CP_RW_BIT) {
                     /* vfp->arm */
-                    if (insn & (1 << 21)) {
+                    if (is_sysreg) {
                         /* system register */
                         rn >>= 1;
 
@@ -XXX,XX +XXX,XX @@ static int disas_vfp_insn(DisasContext *s, uint32_t insn)
                     }
                 } else {
                     /* arm->vfp */
-                    if (insn & (1 << 21)) {
+                    if (is_sysreg) {
                         rn >>= 1;
                         /* system register */
                         switch (rn) {
-- 
2.20.1

Like AArch64, M-profile floating point has no FPEXC enable
bit to gate floating point; so always set the VFPEN TB flag.

M-profile also has CPACR and NSACR similar to A-profile;
they behave slightly differently:
 * the CPACR is banked between Secure and Non-Secure
 * if the NSACR forces a trap then this is taken to
   the Secure state, not the Non-Secure state

Honour the CPACR and NSACR settings. The NSACR handling
requires us to borrow the exception.target_el field
(usually meaningless for M profile) to distinguish the
NOCP UsageFault taken to Secure state from the more
usual fault taken to the current security state.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-6-peter.maydell@linaro.org
---
 target/arm/helper.c    | 55 +++++++++++++++++++++++++++++++++++++++---
 target/arm/translate.c | 10 ++++++--
 2 files changed, 60 insertions(+), 5 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ uint32_t arm_phys_excp_target_el(CPUState *cs, uint32_t excp_idx,
     return target_el;
 }
 
+/*
+ * Return true if the v7M CPACR permits access to the FPU for the specified
+ * security state and privilege level.
+ */
+static bool v7m_cpacr_pass(CPUARMState *env, bool is_secure, bool is_priv)
+{
+    switch (extract32(env->v7m.cpacr[is_secure], 20, 2)) {
+    case 0:
+    case 2: /* UNPREDICTABLE: we treat like 0 */
+        return false;
+    case 1:
+        return is_priv;
+    case 3:
+        return true;
+    default:
+        g_assert_not_reached();
+    }
+}
+
 static bool v7m_stack_write(ARMCPU *cpu, uint32_t addr, uint32_t value,
                             ARMMMUIdx mmu_idx, bool ignfault)
 {
@@ -XXX,XX +XXX,XX @@ void arm_v7m_cpu_do_interrupt(CPUState *cs)
         env->v7m.cfsr[env->v7m.secure] |= R_V7M_CFSR_UNDEFINSTR_MASK;
         break;
     case EXCP_NOCP:
-        armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE, env->v7m.secure);
-        env->v7m.cfsr[env->v7m.secure] |= R_V7M_CFSR_NOCP_MASK;
+    {
+        /*
+         * NOCP might be directed to something other than the current
+         * security state if this fault is because of NSACR; we indicate
+         * the target security state using exception.target_el.
+         */
+        int target_secstate;
+
+        if (env->exception.target_el == 3) {
+            target_secstate = M_REG_S;
+        } else {
+            target_secstate = env->v7m.secure;
+        }
+        armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE, target_secstate);
+        env->v7m.cfsr[target_secstate] |= R_V7M_CFSR_NOCP_MASK;
         break;
+    }
     case EXCP_INVSTATE:
         armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE, env->v7m.secure);
         env->v7m.cfsr[env->v7m.secure] |= R_V7M_CFSR_INVSTATE_MASK;
@@ -XXX,XX +XXX,XX @@ int fp_exception_el(CPUARMState *env, int cur_el)
         return 0;
     }
 
+    if (arm_feature(env, ARM_FEATURE_M)) {
+        /* CPACR can cause a NOCP UsageFault taken to current security state */
+        if (!v7m_cpacr_pass(env, env->v7m.secure, cur_el != 0)) {
+            return 1;
+        }
+
+        if (arm_feature(env, ARM_FEATURE_M_SECURITY) && !env->v7m.secure) {
+            if (!extract32(env->v7m.nsacr, 10, 1)) {
+                /* FP insns cause a NOCP UsageFault taken to Secure */
+                return 3;
+            }
+        }
+
+        return 0;
+    }
+
     /* The CPACR controls traps to EL1, or PL1 if we're 32 bit:
      * 0, 2 : trap EL0 and EL1/PL1 accesses
      * 1    : trap only EL0 accesses
@@ -XXX,XX +XXX,XX @@ void cpu_get_tb_cpu_state(CPUARMState *env, target_ulong *pc,
         flags = FIELD_DP32(flags, TBFLAG_A32, SCTLR_B, arm_sctlr_b(env));
         flags = FIELD_DP32(flags, TBFLAG_A32, NS, !access_secure_reg(env));
         if (env->vfp.xregs[ARM_VFP_FPEXC] & (1 << 30)
-            || arm_el_is_aa64(env, 1)) {
+            || arm_el_is_aa64(env, 1) || arm_feature(env, ARM_FEATURE_M)) {
             flags = FIELD_DP32(flags, TBFLAG_A32, VFPEN, 1);
         }
         flags = FIELD_DP32(flags, TBFLAG_A32, XSCALE_CPAR, env->cp15.c15_cpar);
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_vfp_insn(DisasContext *s, uint32_t insn)
      * for attempts to execute invalid vfp/neon encodings with FP disabled.
      */
     if (s->fp_excp_el) {
-        gen_exception_insn(s, 4, EXCP_UDEF,
-                           syn_fp_access_trap(1, 0xe, false), s->fp_excp_el);
+        if (arm_dc_feature(s, ARM_FEATURE_M)) {
+            gen_exception_insn(s, 4, EXCP_NOCP, syn_uncategorized(),
+                               s->fp_excp_el);
+        } else {
+            gen_exception_insn(s, 4, EXCP_UDEF,
+                               syn_fp_access_trap(1, 0xe, false),
+                               s->fp_excp_el);
+        }
         return 0;
     }
 
-- 
2.20.1

Correct the decode of the M-profile "coprocessor and
floating-point instructions" space:
 * op0 == 0b11 is always unallocated
 * if the CPU has an FPU then all insns with op1 == 0b101
   are floating point and go to disas_vfp_insn()

For the moment we leave VLLDM and VLSTM as NOPs; in
a later commit we will fill in the proper implementation
for the case where an FPU is present.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-7-peter.maydell@linaro.org
---
 target/arm/translate.c | 26 ++++++++++++++++++++++----
 1 file changed, 22 insertions(+), 4 deletions(-)

diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void disas_thumb2_insn(DisasContext *s, uint32_t insn)
     case 6: case 7: case 14: case 15:
         /* Coprocessor.  */
         if (arm_dc_feature(s, ARM_FEATURE_M)) {
-            /* We don't currently implement M profile FP support,
-             * so this entire space should give a NOCP fault, with
-             * the exception of the v8M VLLDM and VLSTM insns, which
-             * must be NOPs in Secure state and UNDEF in Nonsecure state.
+            /* 0b111x_11xx_xxxx_xxxx_xxxx_xxxx_xxxx_xxxx */
+            if (extract32(insn, 24, 2) == 3) {
+                goto illegal_op; /* op0 = 0b11 : unallocated */
+            }
+
+            /*
+             * Decode VLLDM and VLSTM first: these are nonstandard because:
+             *  * if there is no FPU then these insns must NOP in
+             *    Secure state and UNDEF in Nonsecure state
+             *  * if there is an FPU then these insns do not have
+             *    the usual behaviour that disas_vfp_insn() provides of
+             *    being controlled by CPACR/NSACR enable bits or the
+             *    lazy-stacking logic.
              */
             if (arm_dc_feature(s, ARM_FEATURE_V8) &&
                 (insn & 0xffa00f00) == 0xec200a00) {
@@ -XXX,XX +XXX,XX @@ static void disas_thumb2_insn(DisasContext *s, uint32_t insn)
                 /* Just NOP since FP support is not implemented */
                 break;
             }
+            if (arm_dc_feature(s, ARM_FEATURE_VFP) &&
+                ((insn >> 8) & 0xe) == 10) {
+                /* FP, and the CPU supports it */
+                if (disas_vfp_insn(s, insn)) {
+                    goto illegal_op;
+                }
+                break;
+            }
+
             /* All other insns: NOCP */
             gen_exception_insn(s, 4, EXCP_NOCP, syn_uncategorized(),
                                default_exception_el(s));
-- 
2.20.1

If the floating point extension is present, then the SG instruction
must clear the CONTROL_S.SFPA bit. Implement this.

(On a no-FPU system the bit will always be zero, so we don't need
to make the clearing of the bit conditional on ARM_FEATURE_VFP.)

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-8-peter.maydell@linaro.org
---
 target/arm/helper.c | 1 +
 1 file changed, 1 insertion(+)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static bool v7m_handle_execute_nsc(ARMCPU *cpu)
     qemu_log_mask(CPU_LOG_INT, "...really an SG instruction at 0x%08" PRIx32
                   ", executing it\n", env->regs[15]);
     env->regs[14] &= ~1;
+    env->v7m.control[M_REG_S] &= ~R_V7M_CONTROL_SFPA_MASK;
     switch_v7m_security_state(env, true);
     xpsr_write(env, 0, XPSR_IT);
     env->regs[15] += 4;
-- 
2.20.1

The M-profile CONTROL register has two bits -- SFPA and FPCA --
which relate to floating-point support, and should be RES0 otherwise.
Handle them correctly in the MSR/MRS register access code.
Neither is banked between security states, so they are stored
in v7m.control[M_REG_S] regardless of current security state.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-9-peter.maydell@linaro.org
---
 target/arm/helper.c | 57 ++++++++++++++++++++++++++++++++++++++-------
 1 file changed, 49 insertions(+), 8 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ uint32_t HELPER(v7m_mrs)(CPUARMState *env, uint32_t reg)
         return xpsr_read(env) & mask;
         break;
     case 20: /* CONTROL */
-        return env->v7m.control[env->v7m.secure];
+    {
+        uint32_t value = env->v7m.control[env->v7m.secure];
+        if (!env->v7m.secure) {
+            /* SFPA is RAZ/WI from NS; FPCA is stored in the M_REG_S bank */
+            value |= env->v7m.control[M_REG_S] & R_V7M_CONTROL_FPCA_MASK;
+        }
+        return value;
+    }
     case 0x94: /* CONTROL_NS */
         /* We have to handle this here because unprivileged Secure code
          * can read the NS CONTROL register.
@@ -XXX,XX +XXX,XX @@ uint32_t HELPER(v7m_mrs)(CPUARMState *env, uint32_t reg)
         if (!env->v7m.secure) {
             return 0;
         }
-        return env->v7m.control[M_REG_NS];
+        return env->v7m.control[M_REG_NS] |
+            (env->v7m.control[M_REG_S] & R_V7M_CONTROL_FPCA_MASK);
     }
 
     if (el == 0) {
@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_msr)(CPUARMState *env, uint32_t maskreg, uint32_t val)
      */
     uint32_t mask = extract32(maskreg, 8, 4);
     uint32_t reg = extract32(maskreg, 0, 8);
+    int cur_el = arm_current_el(env);
 
-    if (arm_current_el(env) == 0 && reg > 7) {
-        /* only xPSR sub-fields may be written by unprivileged */
+    if (cur_el == 0 && reg > 7 && reg != 20) {
+        /*
+         * only xPSR sub-fields and CONTROL.SFPA may be written by
+         * unprivileged code
+         */
         return;
     }
 
@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_msr)(CPUARMState *env, uint32_t maskreg, uint32_t val)
                 env->v7m.control[M_REG_NS] &= ~R_V7M_CONTROL_NPRIV_MASK;
                 env->v7m.control[M_REG_NS] |= val & R_V7M_CONTROL_NPRIV_MASK;
             }
+            /*
+             * SFPA is RAZ/WI from NS. FPCA is RO if NSACR.CP10 == 0,
+             * RES0 if the FPU is not present, and is stored in the S bank
+             */
+            if (arm_feature(env, ARM_FEATURE_VFP) &&
+                extract32(env->v7m.nsacr, 10, 1)) {
+                env->v7m.control[M_REG_S] &= ~R_V7M_CONTROL_FPCA_MASK;
+                env->v7m.control[M_REG_S] |= val & R_V7M_CONTROL_FPCA_MASK;
+            }
             return;
         case 0x98: /* SP_NS */
         {
@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_msr)(CPUARMState *env, uint32_t maskreg, uint32_t val)
         env->v7m.faultmask[env->v7m.secure] = val & 1;
         break;
     case 20: /* CONTROL */
-        /* Writing to the SPSEL bit only has an effect if we are in
+        /*
+         * Writing to the SPSEL bit only has an effect if we are in
          * thread mode; other bits can be updated by any privileged code.
          * write_v7m_control_spsel() deals with updating the SPSEL bit in
          * env->v7m.control, so we only need update the others.
          * For v7M, we must just ignore explicit writes to SPSEL in handler
          * mode; for v8M the write is permitted but will have no effect.
+         * All these bits are writes-ignored from non-privileged code,
+         * except for SFPA.
          */
-        if (arm_feature(env, ARM_FEATURE_V8) ||
-            !arm_v7m_is_handler_mode(env)) {
+        if (cur_el > 0 && (arm_feature(env, ARM_FEATURE_V8) ||
+                           !arm_v7m_is_handler_mode(env))) {
             write_v7m_control_spsel(env, (val & R_V7M_CONTROL_SPSEL_MASK) != 0);
         }
-        if (arm_feature(env, ARM_FEATURE_M_MAIN)) {
+        if (cur_el > 0 && arm_feature(env, ARM_FEATURE_M_MAIN)) {
             env->v7m.control[env->v7m.secure] &= ~R_V7M_CONTROL_NPRIV_MASK;
             env->v7m.control[env->v7m.secure] |= val & R_V7M_CONTROL_NPRIV_MASK;
         }
+        if (arm_feature(env, ARM_FEATURE_VFP)) {
+            /*
+             * SFPA is RAZ/WI from NS or if no FPU.
+             * FPCA is RO if NSACR.CP10 == 0, RES0 if the FPU is not present.
+             * Both are stored in the S bank.
+             */
+            if (env->v7m.secure) {
+                env->v7m.control[M_REG_S] &= ~R_V7M_CONTROL_SFPA_MASK;
+                env->v7m.control[M_REG_S] |= val & R_V7M_CONTROL_SFPA_MASK;
+            }
+            if (cur_el > 0 &&
+                (env->v7m.secure || !arm_feature(env, ARM_FEATURE_M_SECURITY) ||
+                 extract32(env->v7m.nsacr, 10, 1))) {
+                env->v7m.control[M_REG_S] &= ~R_V7M_CONTROL_FPCA_MASK;
+                env->v7m.control[M_REG_S] |= val & R_V7M_CONTROL_FPCA_MASK;
+            }
+        }
         break;
     default:
     bad_reg:
-- 
2.20.1

Currently the code in v7m_push_stack() which detects a violation
of the v8M stack limit simply returns early if it does so. This
is OK for the current integer-only code, but won't work for the
floating point handling we're about to add. We need to continue
executing the rest of the function so that we check for other
exceptions like not having permission to use the FPU and so
that we correctly set the FPCCR state if we are doing lazy
stacking. Refactor to avoid the early return.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-10-peter.maydell@linaro.org
---
 target/arm/helper.c | 23 ++++++++++++++++++-----
 1 file changed, 18 insertions(+), 5 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
      * should ignore further stack faults trying to process
      * that derived exception.)
      */
-    bool stacked_ok;
+    bool stacked_ok = true, limitviol = false;
     CPUARMState *env = &cpu->env;
     uint32_t xpsr = xpsr_read(env);
     uint32_t frameptr = env->regs[13];
@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
             armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE,
                                     env->v7m.secure);
             env->regs[13] = limit;
-            return true;
+            /*
+             * We won't try to perform any further memory accesses but
+             * we must continue through the following code to check for
+             * permission faults during FPU state preservation, and we
+             * must update FPCCR if lazy stacking is enabled.
+             */
+            limitviol = true;
+            stacked_ok = false;
         }
     }
 
@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
      * (which may be taken in preference to the one we started with
      * if it has higher priority).
      */
-    stacked_ok =
+    stacked_ok = stacked_ok &&
         v7m_stack_write(cpu, frameptr, env->regs[0], mmu_idx, false) &&
         v7m_stack_write(cpu, frameptr + 4, env->regs[1], mmu_idx, false) &&
         v7m_stack_write(cpu, frameptr + 8, env->regs[2], mmu_idx, false) &&
@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
         v7m_stack_write(cpu, frameptr + 24, env->regs[15], mmu_idx, false) &&
         v7m_stack_write(cpu, frameptr + 28, xpsr, mmu_idx, false);
 
-    /* Update SP regardless of whether any of the stack accesses failed. */
-    env->regs[13] = frameptr;
+    /*
+     * If we broke a stack limit then SP was already updated earlier;
+     * otherwise we update SP regardless of whether any of the stack
+     * accesses failed or we took some other kind of fault.
+     */
+    if (!limitviol) {
+        env->regs[13] = frameptr;
+    }
 
     return !stacked_ok;
 }
-- 
2.20.1

Handle floating point registers in exception entry.
This corresponds to the FP-specific parts of the pseudocode
functions ActivateException() and PushStack().

We defer the code corresponding to UpdateFPCCR() to a later patch.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-11-peter.maydell@linaro.org
---
 target/arm/helper.c | 98 +++++++++++++++++++++++++++++++++++++++++++--
 1 file changed, 95 insertions(+), 3 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void v7m_exception_taken(ARMCPU *cpu, uint32_t lr, bool dotailchain,
     switch_v7m_security_state(env, targets_secure);
     write_v7m_control_spsel(env, 0);
     arm_clear_exclusive(env);
+    /* Clear SFPA and FPCA (has no effect if no FPU) */
+    env->v7m.control[M_REG_S] &=
+        ~(R_V7M_CONTROL_FPCA_MASK | R_V7M_CONTROL_SFPA_MASK);
     /* Clear IT bits */
     env->condexec_bits = 0;
     env->regs[14] = lr;
@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
     uint32_t xpsr = xpsr_read(env);
     uint32_t frameptr = env->regs[13];
     ARMMMUIdx mmu_idx = arm_mmu_idx(env);
+    uint32_t framesize;
+    bool nsacr_cp10 = extract32(env->v7m.nsacr, 10, 1);
+
+    if ((env->v7m.control[M_REG_S] & R_V7M_CONTROL_FPCA_MASK) &&
+        (env->v7m.secure || nsacr_cp10)) {
+        if (env->v7m.secure &&
+            env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_TS_MASK) {
+            framesize = 0xa8;
+        } else {
+            framesize = 0x68;
+        }
+    } else {
+        framesize = 0x20;
+    }
 
     /* Align stack pointer if the guest wants that */
     if ((frameptr & 4) &&
@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
         xpsr |= XPSR_SPREALIGN;
     }
 
-    frameptr -= 0x20;
+    xpsr &= ~XPSR_SFPA;
+    if (env->v7m.secure &&
+        (env->v7m.control[M_REG_S] & R_V7M_CONTROL_SFPA_MASK)) {
+        xpsr |= XPSR_SFPA;
+    }
+
+    frameptr -= framesize;
 
     if (arm_feature(env, ARM_FEATURE_V8)) {
         uint32_t limit = v7m_sp_limit(env);
@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
         v7m_stack_write(cpu, frameptr + 24, env->regs[15], mmu_idx, false) &&
         v7m_stack_write(cpu, frameptr + 28, xpsr, mmu_idx, false);
 
+    if (env->v7m.control[M_REG_S] & R_V7M_CONTROL_FPCA_MASK) {
+        /* FPU is active, try to save its registers */
+        bool fpccr_s = env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_S_MASK;
+        bool lspact = env->v7m.fpccr[fpccr_s] & R_V7M_FPCCR_LSPACT_MASK;
+
+        if (lspact && arm_feature(env, ARM_FEATURE_M_SECURITY)) {
+            qemu_log_mask(CPU_LOG_INT,
+                          "...SecureFault because LSPACT and FPCA both set\n");
+            env->v7m.sfsr |= R_V7M_SFSR_LSERR_MASK;
+            armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_SECURE, false);
+        } else if (!env->v7m.secure && !nsacr_cp10) {
+            qemu_log_mask(CPU_LOG_INT,
+                          "...Secure UsageFault with CFSR.NOCP because "
+                          "NSACR.CP10 prevents stacking FP regs\n");
+            armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE, M_REG_S);
+            env->v7m.cfsr[M_REG_S] |= R_V7M_CFSR_NOCP_MASK;
+        } else {
+            if (!(env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_LSPEN_MASK)) {
+                /* Lazy stacking disabled, save registers now */
+                int i;
+                bool cpacr_pass = v7m_cpacr_pass(env, env->v7m.secure,
+                                                 arm_current_el(env) != 0);
+
+                if (stacked_ok && !cpacr_pass) {
+                    /*
+                     * Take UsageFault if CPACR forbids access. The pseudocode
+                     * here does a full CheckCPEnabled() but we know the NSACR
+                     * check can never fail as we have already handled that.
+                     */
+                    qemu_log_mask(CPU_LOG_INT,
+                                  "...UsageFault with CFSR.NOCP because "
+                                  "CPACR.CP10 prevents stacking FP regs\n");
+                    armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE,
+                                            env->v7m.secure);
+                    env->v7m.cfsr[env->v7m.secure] |= R_V7M_CFSR_NOCP_MASK;
+                    stacked_ok = false;
+                }
+
+                for (i = 0; i < ((framesize == 0xa8) ? 32 : 16); i += 2) {
+                    uint64_t dn = *aa32_vfp_dreg(env, i / 2);
+                    uint32_t faddr = frameptr + 0x20 + 4 * i;
+                    uint32_t slo = extract64(dn, 0, 32);
+                    uint32_t shi = extract64(dn, 32, 32);
+
+                    if (i >= 16) {
+                        faddr += 8; /* skip the slot for the FPSCR */
+                    }
+                    stacked_ok = stacked_ok &&
+                        v7m_stack_write(cpu, faddr, slo, mmu_idx, false) &&
+                        v7m_stack_write(cpu, faddr + 4, shi, mmu_idx, false);
+                }
+                stacked_ok = stacked_ok &&
+                    v7m_stack_write(cpu, frameptr + 0x60,
+                                    vfp_get_fpscr(env), mmu_idx, false);
+                if (cpacr_pass) {
+                    for (i = 0; i < ((framesize == 0xa8) ? 32 : 16); i += 2) {
+                        *aa32_vfp_dreg(env, i / 2) = 0;
+                    }
+                    vfp_set_fpscr(env, 0);
+                }
+            } else {
+                /* Lazy stacking enabled, save necessary info to stack later */
+                /* TODO : equivalent of UpdateFPCCR() pseudocode */
+            }
+        }
+    }
+
     /*
      * If we broke a stack limit then SP was already updated earlier;
      * otherwise we update SP regardless of whether any of the stack
@@ -XXX,XX +XXX,XX @@ void arm_v7m_cpu_do_interrupt(CPUState *cs)
 
     if (arm_feature(env, ARM_FEATURE_V8)) {
         lr = R_V7M_EXCRET_RES1_MASK |
-            R_V7M_EXCRET_DCRS_MASK |
-            R_V7M_EXCRET_FTYPE_MASK;
+            R_V7M_EXCRET_DCRS_MASK;
         /* The S bit indicates whether we should return to Secure
          * or NonSecure (ie our current state).
          * The ES bit indicates whether we're taking this exception
@@ -XXX,XX +XXX,XX @@ void arm_v7m_cpu_do_interrupt(CPUState *cs)
         if (env->v7m.secure) {
             lr |= R_V7M_EXCRET_S_MASK;
         }
+        if (!(env->v7m.control[M_REG_S] & R_V7M_CONTROL_FPCA_MASK)) {
+            lr |= R_V7M_EXCRET_FTYPE_MASK;
+        }
     } else {
         lr = R_V7M_EXCRET_RES1_MASK |
             R_V7M_EXCRET_S_MASK |
-- 
2.20.1

Implement the code which updates the FPCCR register on an
exception entry where we are going to use lazy FP stacking.
We have to defer to the NVIC to determine whether the
various exceptions are currently ready or not.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Message-id: 20190416125744.27770-12-peter.maydell@linaro.org
---
 target/arm/cpu.h      | 14 +++++++++
 hw/intc/armv7m_nvic.c | 34 ++++++++++++++++++++++
 target/arm/helper.c   | 67 ++++++++++++++++++++++++++++++++++++++++++-
 3 files changed, 114 insertions(+), 1 deletion(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ void armv7m_nvic_acknowledge_irq(void *opaque);
  * (Ignoring -1, this is the same as the RETTOBASE value before completion.)
  */
 int armv7m_nvic_complete_irq(void *opaque, int irq, bool secure);
+/**
+ * armv7m_nvic_get_ready_status(void *opaque, int irq, bool secure)
+ * @opaque: the NVIC
+ * @irq: the exception number to mark pending
+ * @secure: false for non-banked exceptions or for the nonsecure
+ * version of a banked exception, true for the secure version of a banked
+ * exception.
+ *
+ * Return whether an exception is "ready", i.e. whether the exception is
+ * enabled and is configured at a priority which would allow it to
+ * interrupt the current execution priority. This controls whether the
+ * RDY bit for it in the FPCCR is set.
+ */
+bool armv7m_nvic_get_ready_status(void *opaque, int irq, bool secure);
 /**
  * armv7m_nvic_raw_execution_priority: return the raw execution priority
  * @opaque: the NVIC
diff --git a/hw/intc/armv7m_nvic.c b/hw/intc/armv7m_nvic.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/intc/armv7m_nvic.c
+++ b/hw/intc/armv7m_nvic.c
@@ -XXX,XX +XXX,XX @@ int armv7m_nvic_complete_irq(void *opaque, int irq, bool secure)
     return ret;
 }
 
+bool armv7m_nvic_get_ready_status(void *opaque, int irq, bool secure)
+{
+    /*
+     * Return whether an exception is "ready", i.e. it is enabled and is
+     * configured at a priority which would allow it to interrupt the
+     * current execution priority.
+     *
+     * irq and secure have the same semantics as for armv7m_nvic_set_pending():
+     * for non-banked exceptions secure is always false; for banked exceptions
+     * it indicates which of the exceptions is required.
+     */
+    NVICState *s = (NVICState *)opaque;
+    bool banked = exc_is_banked(irq);
+    VecInfo *vec;
+    int running = nvic_exec_prio(s);
+
+    assert(irq > ARMV7M_EXCP_RESET && irq < s->num_irq);
+    assert(!secure || banked);
+
+    /*
+     * HardFault is an odd special case: we always check against -1,
+     * even if we're secure and HardFault has priority -3; we never
+     * need to check for enabled state.
+     */
+    if (irq == ARMV7M_EXCP_HARD) {
+        return running > -1;
+    }
+
+    vec = (banked && secure) ? &s->sec_vectors[irq] : &s->vectors[irq];
+
+    return vec->enabled &&
+        exc_group_prio(s, vec->prio, secure) < running;
+}
+
 /* callback when external interrupt line is changed */
 static void set_irq_level(void *opaque, int n, int level)
 {
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void v7m_exception_taken(ARMCPU *cpu, uint32_t lr, bool dotailchain,
     env->thumb = addr & 1;
 }
 
+static void v7m_update_fpccr(CPUARMState *env, uint32_t frameptr,
+                             bool apply_splim)
+{
+    /*
+     * Like the pseudocode UpdateFPCCR: save state in FPCAR and FPCCR
+     * that we will need later in order to do lazy FP reg stacking.
+     */
+    bool is_secure = env->v7m.secure;
+    void *nvic = env->nvic;
+    /*
+     * Some bits are unbanked and live always in fpccr[M_REG_S]; some bits
+     * are banked and we want to update the bit in the bank for the
+     * current security state; and in one case we want to specifically
+     * update the NS banked version of a bit even if we are secure.
+     */
+    uint32_t *fpccr_s = &env->v7m.fpccr[M_REG_S];
+    uint32_t *fpccr_ns = &env->v7m.fpccr[M_REG_NS];
+    uint32_t *fpccr = &env->v7m.fpccr[is_secure];
+    bool hfrdy, bfrdy, mmrdy, ns_ufrdy, s_ufrdy, sfrdy, monrdy;
+
+    env->v7m.fpcar[is_secure] = frameptr & ~0x7;
+
+    if (apply_splim && arm_feature(env, ARM_FEATURE_V8)) {
+        bool splimviol;
+        uint32_t splim = v7m_sp_limit(env);
+        bool ign = armv7m_nvic_neg_prio_requested(nvic, is_secure) &&
+            (env->v7m.ccr[is_secure] & R_V7M_CCR_STKOFHFNMIGN_MASK);
+
+        splimviol = !ign && frameptr < splim;
+        *fpccr = FIELD_DP32(*fpccr, V7M_FPCCR, SPLIMVIOL, splimviol);
+    }
+
+    *fpccr = FIELD_DP32(*fpccr, V7M_FPCCR, LSPACT, 1);
+
+    *fpccr_s = FIELD_DP32(*fpccr_s, V7M_FPCCR, S, is_secure);
+
+    *fpccr = FIELD_DP32(*fpccr, V7M_FPCCR, USER, arm_current_el(env) == 0);
+
+    *fpccr = FIELD_DP32(*fpccr, V7M_FPCCR, THREAD,
+                        !arm_v7m_is_handler_mode(env));
+
+    hfrdy = armv7m_nvic_get_ready_status(nvic, ARMV7M_EXCP_HARD, false);
+    *fpccr_s = FIELD_DP32(*fpccr_s, V7M_FPCCR, HFRDY, hfrdy);
+
+    bfrdy = armv7m_nvic_get_ready_status(nvic, ARMV7M_EXCP_BUS, false);
+    *fpccr_s = FIELD_DP32(*fpccr_s, V7M_FPCCR, BFRDY, bfrdy);
+
+    mmrdy = armv7m_nvic_get_ready_status(nvic, ARMV7M_EXCP_MEM, is_secure);
+    *fpccr = FIELD_DP32(*fpccr, V7M_FPCCR, MMRDY, mmrdy);
+
+    ns_ufrdy = armv7m_nvic_get_ready_status(nvic, ARMV7M_EXCP_USAGE, false);
+    *fpccr_ns = FIELD_DP32(*fpccr_ns, V7M_FPCCR, UFRDY, ns_ufrdy);
+
+    monrdy = armv7m_nvic_get_ready_status(nvic, ARMV7M_EXCP_DEBUG, false);
+    *fpccr_s = FIELD_DP32(*fpccr_s, V7M_FPCCR, MONRDY, monrdy);
+
+    if (arm_feature(env, ARM_FEATURE_M_SECURITY)) {
+        s_ufrdy = armv7m_nvic_get_ready_status(nvic, ARMV7M_EXCP_USAGE, true);
+        *fpccr_s = FIELD_DP32(*fpccr_s, V7M_FPCCR, UFRDY, s_ufrdy);
+
+        sfrdy = armv7m_nvic_get_ready_status(nvic, ARMV7M_EXCP_SECURE, false);
+        *fpccr_s = FIELD_DP32(*fpccr_s, V7M_FPCCR, SFRDY, sfrdy);
+    }
+}
+
 static bool v7m_push_stack(ARMCPU *cpu)
 {
     /* Do the "set up stack frame" part of exception entry,
@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
                 }
             } else {
                 /* Lazy stacking enabled, save necessary info to stack later */
-                /* TODO : equivalent of UpdateFPCCR() pseudocode */
+                v7m_update_fpccr(env, frameptr + 0x20, true);
             }
         }
     }
-- 
2.20.1

For v8M floating point support, transitions from Secure
to Non-secure state via BLNS and BLXNS must clear the
CONTROL.SFPA bit. (This corresponds to the pseudocode
BranchToNS() function.)

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-13-peter.maydell@linaro.org
---
 target/arm/helper.c | 4 ++++
 1 file changed, 4 insertions(+)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_bxns)(CPUARMState *env, uint32_t dest)
     /* translate.c should have made BXNS UNDEF unless we're secure */
     assert(env->v7m.secure);
 
+    if (!(dest & 1)) {
+        env->v7m.control[M_REG_S] &= ~R_V7M_CONTROL_SFPA_MASK;
+    }
     switch_v7m_security_state(env, dest & 1);
     env->thumb = 1;
     env->regs[15] = dest & ~1;
@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_blxns)(CPUARMState *env, uint32_t dest)
          */
         write_v7m_exception(env, 1);
     }
+    env->v7m.control[M_REG_S] &= ~R_V7M_CONTROL_SFPA_MASK;
     switch_v7m_security_state(env, 0);
     env->thumb = 1;
     env->regs[15] = dest;
-- 
2.20.1

The TailChain() pseudocode specifies that a tail chaining
exception should sanitize the excReturn all-ones bits and
(if there is no FPU) the excReturn FType bits; we weren't
doing this.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-14-peter.maydell@linaro.org
---
 target/arm/helper.c | 8 ++++++++
 1 file changed, 8 insertions(+)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void v7m_exception_taken(ARMCPU *cpu, uint32_t lr, bool dotailchain,
     qemu_log_mask(CPU_LOG_INT, "...taking pending %s exception %d\n",
                   targets_secure ? "secure" : "nonsecure", exc);
 
+    if (dotailchain) {
+        /* Sanitize LR FType and PREFIX bits */
+        if (!arm_feature(env, ARM_FEATURE_VFP)) {
+            lr |= R_V7M_EXCRET_FTYPE_MASK;
+        }
+        lr = deposit32(lr, 24, 8, 0xff);
+    }
+
     if (arm_feature(env, ARM_FEATURE_V8)) {
         if (arm_feature(env, ARM_FEATURE_M_SECURITY) &&
             (lr & R_V7M_EXCRET_S_MASK)) {
-- 
2.20.1

The magic value pushed onto the callee stack as an integrity
check is different if floating point is present.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-15-peter.maydell@linaro.org
---
 target/arm/helper.c | 22 +++++++++++++++++++---
 1 file changed, 19 insertions(+), 3 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ load_fail:
     return false;
 }
 
+static uint32_t v7m_integrity_sig(CPUARMState *env, uint32_t lr)
+{
+    /*
+     * Return the integrity signature value for the callee-saves
+     * stack frame section. @lr is the exception return payload/LR value
+     * whose FType bit forms bit 0 of the signature if FP is present.
+     */
+    uint32_t sig = 0xfefa125a;
+
+    if (!arm_feature(env, ARM_FEATURE_VFP) || (lr & R_V7M_EXCRET_FTYPE_MASK)) {
+        sig |= 1;
+    }
+    return sig;
+}
+
 static bool v7m_push_callee_stack(ARMCPU *cpu, uint32_t lr, bool dotailchain,
                                   bool ignore_faults)
 {
@@ -XXX,XX +XXX,XX @@ static bool v7m_push_callee_stack(ARMCPU *cpu, uint32_t lr, bool dotailchain,
     bool stacked_ok;
     uint32_t limit;
     bool want_psp;
+    uint32_t sig;
 
     if (dotailchain) {
         bool mode = lr & R_V7M_EXCRET_MODE_MASK;
@@ -XXX,XX +XXX,XX @@ static bool v7m_push_callee_stack(ARMCPU *cpu, uint32_t lr, bool dotailchain,
     /* Write as much of the stack frame as we can. A write failure may
      * cause us to pend a derived exception.
      */
+    sig = v7m_integrity_sig(env, lr);
     stacked_ok =
-        v7m_stack_write(cpu, frameptr, 0xfefa125b, mmu_idx, ignore_faults) &&
+        v7m_stack_write(cpu, frameptr, sig, mmu_idx, ignore_faults) &&
         v7m_stack_write(cpu, frameptr + 0x8, env->regs[4], mmu_idx,
                         ignore_faults) &&
         v7m_stack_write(cpu, frameptr + 0xc, env->regs[5], mmu_idx,
@@ -XXX,XX +XXX,XX @@ static void do_v7m_exception_exit(ARMCPU *cpu)
         if (return_to_secure &&
             ((excret & R_V7M_EXCRET_ES_MASK) == 0 ||
              (excret & R_V7M_EXCRET_DCRS_MASK) == 0)) {
-            uint32_t expected_sig = 0xfefa125b;
             uint32_t actual_sig;
 
             pop_ok = v7m_stack_read(cpu, &actual_sig, frameptr, mmu_idx);
 
-            if (pop_ok && expected_sig != actual_sig) {
+            if (pop_ok && v7m_integrity_sig(env, excret) != actual_sig) {
                 /* Take a SecureFault on the current stack */
                 env->v7m.sfsr |= R_V7M_SFSR_INVIS_MASK;
                 armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_SECURE, false);
-- 
2.20.1

Handle floating point registers in exception return.
This corresponds to pseudocode functions ValidateExceptionReturn(),
ExceptionReturn(), PopStack() and ConsumeExcStackFrame().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-16-peter.maydell@linaro.org
---
 target/arm/helper.c | 142 +++++++++++++++++++++++++++++++++++++++++++-
 1 file changed, 141 insertions(+), 1 deletion(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static void do_v7m_exception_exit(ARMCPU *cpu)
     bool rettobase = false;
     bool exc_secure = false;
     bool return_to_secure;
+    bool ftype;
+    bool restore_s16_s31;
 
     /* If we're not in Handler mode then jumps to magic exception-exit
      * addresses don't have magic behaviour. However for the v8M
@@ -XXX,XX +XXX,XX @@ static void do_v7m_exception_exit(ARMCPU *cpu)
                       excret);
     }
 
+    ftype = excret & R_V7M_EXCRET_FTYPE_MASK;
+
+    if (!arm_feature(env, ARM_FEATURE_VFP) && !ftype) {
+        qemu_log_mask(LOG_GUEST_ERROR, "M profile: zero FTYPE in exception "
+                      "exit PC value 0x%" PRIx32 " is UNPREDICTABLE "
+                      "if FPU not present\n",
+                      excret);
+        ftype = true;
+    }
+
     if (arm_feature(env, ARM_FEATURE_M_SECURITY)) {
         /* EXC_RETURN.ES validation check (R_SMFL). We must do this before
          * we pick which FAULTMASK to clear.
@@ -XXX,XX +XXX,XX @@ static void do_v7m_exception_exit(ARMCPU *cpu)
      */
     write_v7m_control_spsel_for_secstate(env, return_to_sp_process, exc_secure);
 
+    /*
+     * Clear scratch FP values left in caller saved registers; this
+     * must happen before any kind of tail chaining.
+     */
+    if ((env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_CLRONRET_MASK) &&
+        (env->v7m.control[M_REG_S] & R_V7M_CONTROL_FPCA_MASK)) {
+        if (env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_LSPACT_MASK) {
+            env->v7m.sfsr |= R_V7M_SFSR_LSERR_MASK;
+            armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_SECURE, false);
+            qemu_log_mask(CPU_LOG_INT, "...taking SecureFault on existing "
+                          "stackframe: error during lazy state deactivation\n");
+            v7m_exception_taken(cpu, excret, true, false);
+            return;
+        } else {
+            /* Clear s0..s15 and FPSCR */
+            int i;
+
+            for (i = 0; i < 16; i += 2) {
+                *aa32_vfp_dreg(env, i / 2) = 0;
+            }
+            vfp_set_fpscr(env, 0);
+        }
+    }
+
     if (sfault) {
         env->v7m.sfsr |= R_V7M_SFSR_INVER_MASK;
         armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_SECURE, false);
@@ -XXX,XX +XXX,XX @@ static void do_v7m_exception_exit(ARMCPU *cpu)
             }
         }
 
+        if (!ftype) {
+            /* FP present and we need to handle it */
+            if (!return_to_secure &&
+                (env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_LSPACT_MASK)) {
+                armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_SECURE, false);
+                env->v7m.sfsr |= R_V7M_SFSR_LSERR_MASK;
+                qemu_log_mask(CPU_LOG_INT,
+                              "...taking SecureFault on existing stackframe: "
+                              "Secure LSPACT set but exception return is "
+                              "not to secure state\n");
+                v7m_exception_taken(cpu, excret, true, false);
+                return;
+            }
+
+            restore_s16_s31 = return_to_secure &&
+                (env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_TS_MASK);
+
+            if (env->v7m.fpccr[return_to_secure] & R_V7M_FPCCR_LSPACT_MASK) {
+                /* State in FPU is still valid, just clear LSPACT */
+                env->v7m.fpccr[return_to_secure] &= ~R_V7M_FPCCR_LSPACT_MASK;
+            } else {
+                int i;
+                uint32_t fpscr;
+                bool cpacr_pass, nsacr_pass;
+
+                cpacr_pass = v7m_cpacr_pass(env, return_to_secure,
+                                            return_to_priv);
+                nsacr_pass = return_to_secure ||
+                    extract32(env->v7m.nsacr, 10, 1);
+
+                if (!cpacr_pass) {
+                    armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE,
+                                            return_to_secure);
+                    env->v7m.cfsr[return_to_secure] |= R_V7M_CFSR_NOCP_MASK;
+                    qemu_log_mask(CPU_LOG_INT,
+                                  "...taking UsageFault on existing "
+                                  "stackframe: CPACR.CP10 prevents unstacking "
+                                  "FP regs\n");
+                    v7m_exception_taken(cpu, excret, true, false);
+                    return;
+                } else if (!nsacr_pass) {
+                    armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE, true);
+                    env->v7m.cfsr[M_REG_S] |= R_V7M_CFSR_INVPC_MASK;
+                    qemu_log_mask(CPU_LOG_INT,
+                                  "...taking Secure UsageFault on existing "
+                                  "stackframe: NSACR.CP10 prevents unstacking "
+                                  "FP regs\n");
+                    v7m_exception_taken(cpu, excret, true, false);
+                    return;
+                }
+
+                for (i = 0; i < (restore_s16_s31 ? 32 : 16); i += 2) {
+                    uint32_t slo, shi;
+                    uint64_t dn;
+                    uint32_t faddr = frameptr + 0x20 + 4 * i;
+
+                    if (i >= 16) {
+                        faddr += 8; /* Skip the slot for the FPSCR */
+                    }
+
+                    pop_ok = pop_ok &&
+                        v7m_stack_read(cpu, &slo, faddr, mmu_idx) &&
+                        v7m_stack_read(cpu, &shi, faddr + 4, mmu_idx);
+
+                    if (!pop_ok) {
+                        break;
+                    }
+
+                    dn = (uint64_t)shi << 32 | slo;
+                    *aa32_vfp_dreg(env, i / 2) = dn;
+                }
+                pop_ok = pop_ok &&
+                    v7m_stack_read(cpu, &fpscr, frameptr + 0x60, mmu_idx);
+                if (pop_ok) {
+                    vfp_set_fpscr(env, fpscr);
+                }
+                if (!pop_ok) {
+                    /*
+                     * These regs are 0 if security extension present;
+                     * otherwise merely UNKNOWN. We zero always.
+                     */
+                    for (i = 0; i < (restore_s16_s31 ? 32 : 16); i += 2) {
+                        *aa32_vfp_dreg(env, i / 2) = 0;
+                    }
+                    vfp_set_fpscr(env, 0);
+                }
+            }
+        }
+        env->v7m.control[M_REG_S] = FIELD_DP32(env->v7m.control[M_REG_S],
+                                               V7M_CONTROL, FPCA, !ftype);
+
         /* Commit to consuming the stack frame */
         frameptr += 0x20;
+        if (!ftype) {
+            frameptr += 0x48;
+            if (restore_s16_s31) {
+                frameptr += 0x40;
+            }
+        }
         /* Undo stack alignment (the SPREALIGN bit indicates that the original
          * pre-exception SP was not 8-aligned and we added a padding word to
          * align it, so we undo this by ORing in the bit that increases it
@@ -XXX,XX +XXX,XX @@ static void do_v7m_exception_exit(ARMCPU *cpu)
         *frame_sp_p = frameptr;
     }
     /* This xpsr_write() will invalidate frame_sp_p as it may switch stack */
-    xpsr_write(env, xpsr, ~XPSR_SPREALIGN);
+    xpsr_write(env, xpsr, ~(XPSR_SPREALIGN | XPSR_SFPA));
+
+    if (env->v7m.secure) {
+        bool sfpa = xpsr & XPSR_SFPA;
+
+        env->v7m.control[M_REG_S] = FIELD_DP32(env->v7m.control[M_REG_S],
+                                               V7M_CONTROL, SFPA, sfpa);
+    }
 
     /* The restored xPSR exception field will be zero if we're
      * resuming in Thread mode. If that doesn't match what the
-- 
2.20.1

Move the NS TBFLAG down from bit 19 to bit 6, which has not
been used since commit c1e3781090b9d36c60 in 2015, when we
started passing the entire MMU index in the TB flags rather
than just a 'privilege level' bit.

This rearrangement is not strictly necessary, but means that
we can put M-profile-only bits next to each other rather
than scattered across the flag word.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-17-peter.maydell@linaro.org
---
 target/arm/cpu.h | 11 ++++++-----
 1 file changed, 6 insertions(+), 5 deletions(-)

We are close to running out of TB flags for AArch32; we could
start using the cs_base word, but before we do that we can
economise on our usage by sharing the same bits for the VFP
VECSTRIDE field and the XScale XSCALE_CPAR field. This
works because no XScale CPU ever had VFP.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-18-peter.maydell@linaro.org
---
 target/arm/cpu.h       | 10 ++++++----
 target/arm/cpu.c       |  7 +++++++
 target/arm/helper.c    |  6 +++++-
 target/arm/translate.c |  9 +++++++--
 4 files changed, 25 insertions(+), 7 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ FIELD(TBFLAG_ANY, BE_DATA, 23, 1)
 FIELD(TBFLAG_A32, THUMB, 0, 1)
 FIELD(TBFLAG_A32, VECLEN, 1, 3)
 FIELD(TBFLAG_A32, VECSTRIDE, 4, 2)
+/*
+ * We store the bottom two bits of the CPAR as TB flags and handle
+ * checks on the other bits at runtime. This shares the same bits as
+ * VECSTRIDE, which is OK as no XScale CPU has VFP.
+ */
+FIELD(TBFLAG_A32, XSCALE_CPAR, 4, 2)
 /*
  * Indicates whether cp register reads and writes by guest code should access
  * the secure or nonsecure bank of banked registers; note that this is not
@@ -XXX,XX +XXX,XX @@ FIELD(TBFLAG_A32, NS, 6, 1)
 FIELD(TBFLAG_A32, VFPEN, 7, 1)
 FIELD(TBFLAG_A32, CONDEXEC, 8, 8)
 FIELD(TBFLAG_A32, SCTLR_B, 16, 1)
-/* We store the bottom two bits of the CPAR as TB flags and handle
- * checks on the other bits at runtime
- */
-FIELD(TBFLAG_A32, XSCALE_CPAR, 17, 2)
 /* For M profile only, Handler (ie not Thread) mode */
 FIELD(TBFLAG_A32, HANDLER, 21, 1)
 /* For M profile only, whether we should generate stack-limit checks */
diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void arm_cpu_realizefn(DeviceState *dev, Error **errp)
         set_feature(env, ARM_FEATURE_THUMB_DSP);
     }
 
+    /*
+     * We rely on no XScale CPU having VFP so we can use the same bits in the
+     * TB flags field for VECSTRIDE and XSCALE_CPAR.
+     */
+    assert(!(arm_feature(env, ARM_FEATURE_VFP) &&
+             arm_feature(env, ARM_FEATURE_XSCALE)));
+
     if (arm_feature(env, ARM_FEATURE_V7) &&
         !arm_feature(env, ARM_FEATURE_M) &&
         !arm_feature(env, ARM_FEATURE_PMSA)) {
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void cpu_get_tb_cpu_state(CPUARMState *env, target_ulong *pc,
             || arm_el_is_aa64(env, 1) || arm_feature(env, ARM_FEATURE_M)) {
             flags = FIELD_DP32(flags, TBFLAG_A32, VFPEN, 1);
         }
-        flags = FIELD_DP32(flags, TBFLAG_A32, XSCALE_CPAR, env->cp15.c15_cpar);
+        /* Note that XSCALE_CPAR shares bits with VECSTRIDE */
+        if (arm_feature(env, ARM_FEATURE_XSCALE)) {
+            flags = FIELD_DP32(flags, TBFLAG_A32,
+                               XSCALE_CPAR, env->cp15.c15_cpar);
+        }
     }
 
     flags = FIELD_DP32(flags, TBFLAG_ANY, MMUIDX, arm_to_core_mmu_idx(mmu_idx));
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void arm_tr_init_disas_context(DisasContextBase *dcbase, CPUState *cs)
     dc->fp_excp_el = FIELD_EX32(tb_flags, TBFLAG_ANY, FPEXC_EL);
     dc->vfp_enabled = FIELD_EX32(tb_flags, TBFLAG_A32, VFPEN);
     dc->vec_len = FIELD_EX32(tb_flags, TBFLAG_A32, VECLEN);
-    dc->vec_stride = FIELD_EX32(tb_flags, TBFLAG_A32, VECSTRIDE);
-    dc->c15_cpar = FIELD_EX32(tb_flags, TBFLAG_A32, XSCALE_CPAR);
+    if (arm_feature(env, ARM_FEATURE_XSCALE)) {
+        dc->c15_cpar = FIELD_EX32(tb_flags, TBFLAG_A32, XSCALE_CPAR);
+        dc->vec_stride = 0;
+    } else {
+        dc->vec_stride = FIELD_EX32(tb_flags, TBFLAG_A32, VECSTRIDE);
+        dc->c15_cpar = 0;
+    }
     dc->v7m_handler_mode = FIELD_EX32(tb_flags, TBFLAG_A32, HANDLER);
     dc->v8m_secure = arm_feature(env, ARM_FEATURE_M_SECURITY) &&
         regime_is_secure(env, dc->mmu_idx);
-- 
2.20.1

The M-profile FPCCR.S bit indicates the security status of
the floating point context. In the pseudocode ExecuteFPCheck()
function it is unconditionally set to match the current
security state whenever a floating point instruction is
executed.

Implement this by adding a new TB flag which tracks whether
FPCCR.S is different from the current security state, so
that we only need to emit the code to update it in the
less-common case when it is not already set correctly.

Note that we will add the handling for the other work done
by ExecuteFPCheck() in later commits.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-19-peter.maydell@linaro.org
---
 target/arm/cpu.h       |  2 ++
 target/arm/translate.h |  1 +
 target/arm/helper.c    |  5 +++++
 target/arm/translate.c | 20 ++++++++++++++++++++
 4 files changed, 28 insertions(+)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ FIELD(TBFLAG_A32, NS, 6, 1)
 FIELD(TBFLAG_A32, VFPEN, 7, 1)
 FIELD(TBFLAG_A32, CONDEXEC, 8, 8)
 FIELD(TBFLAG_A32, SCTLR_B, 16, 1)
+/* For M profile only, set if FPCCR.S does not match current security state */
+FIELD(TBFLAG_A32, FPCCR_S_WRONG, 20, 1)
 /* For M profile only, Handler (ie not Thread) mode */
 FIELD(TBFLAG_A32, HANDLER, 21, 1)
 /* For M profile only, whether we should generate stack-limit checks */
diff --git a/target/arm/translate.h b/target/arm/translate.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.h
+++ b/target/arm/translate.h
@@ -XXX,XX +XXX,XX @@ typedef struct DisasContext {
     bool v7m_handler_mode;
     bool v8m_secure; /* true if v8M and we're in Secure mode */
     bool v8m_stackcheck; /* true if we need to perform v8M stack limit checks */
+    bool v8m_fpccr_s_wrong; /* true if v8M FPCCR.S != v8m_secure */
     /* Immediate value in AArch32 SVC insn; must be set if is_jmp == DISAS_SWI
      * so that top level loop can generate correct syndrome information.
      */
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void cpu_get_tb_cpu_state(CPUARMState *env, target_ulong *pc,
         flags = FIELD_DP32(flags, TBFLAG_A32, STACKCHECK, 1);
     }
 
+    if (arm_feature(env, ARM_FEATURE_M_SECURITY) &&
+        FIELD_EX32(env->v7m.fpccr[M_REG_S], V7M_FPCCR, S) != env->v7m.secure) {
+        flags = FIELD_DP32(flags, TBFLAG_A32, FPCCR_S_WRONG, 1);
+    }
+
     *pflags = flags;
     *cs_base = 0;
 }
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_vfp_insn(DisasContext *s, uint32_t insn)
         }
     }
 
+    if (arm_dc_feature(s, ARM_FEATURE_M)) {
+        /* Handle M-profile lazy FP state mechanics */
+
+        /* Update ownership of FP context: set FPCCR.S to match current state */
+        if (s->v8m_fpccr_s_wrong) {
+            TCGv_i32 tmp;
+
+            tmp = load_cpu_field(v7m.fpccr[M_REG_S]);
+            if (s->v8m_secure) {
+                tcg_gen_ori_i32(tmp, tmp, R_V7M_FPCCR_S_MASK);
+            } else {
+                tcg_gen_andi_i32(tmp, tmp, ~R_V7M_FPCCR_S_MASK);
+            }
+            store_cpu_field(tmp, v7m.fpccr[M_REG_S]);
+            /* Don't need to do this for any further FP insns in this TB */
+            s->v8m_fpccr_s_wrong = false;
+        }
+    }
+
     if (extract32(insn, 28, 4) == 0xf) {
         /*
          * Encodings with T=1 (Thumb) or unconditional (ARM):
@@ -XXX,XX +XXX,XX @@ static void arm_tr_init_disas_context(DisasContextBase *dcbase, CPUState *cs)
     dc->v8m_secure = arm_feature(env, ARM_FEATURE_M_SECURITY) &&
         regime_is_secure(env, dc->mmu_idx);
     dc->v8m_stackcheck = FIELD_EX32(tb_flags, TBFLAG_A32, STACKCHECK);
+    dc->v8m_fpccr_s_wrong = FIELD_EX32(tb_flags, TBFLAG_A32, FPCCR_S_WRONG);
     dc->cp_regs = cpu->cp_regs;
     dc->features = env->features;
 
-- 
2.20.1

The M-profile FPCCR.ASPEN bit indicates that automatic floating-point
context preservation is enabled. Before executing any floating-point
instruction, if FPCCR.ASPEN is set and the CONTROL FPCA/SFPA bits
indicate that there is no active floating point context then we
must create a new context (by initializing FPSCR and setting
FPCA/SFPA to indicate that the context is now active). In the
pseudocode this is handled by ExecuteFPCheck().

Implement this with a new TB flag which tracks whether we
need to create a new FP context.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-20-peter.maydell@linaro.org
---
 target/arm/cpu.h       |  2 ++
 target/arm/translate.h |  1 +
 target/arm/helper.c    | 13 +++++++++++++
 target/arm/translate.c | 29 +++++++++++++++++++++++++++++
 4 files changed, 45 insertions(+)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ FIELD(TBFLAG_A32, NS, 6, 1)
 FIELD(TBFLAG_A32, VFPEN, 7, 1)
 FIELD(TBFLAG_A32, CONDEXEC, 8, 8)
 FIELD(TBFLAG_A32, SCTLR_B, 16, 1)
+/* For M profile only, set if we must create a new FP context */
+FIELD(TBFLAG_A32, NEW_FP_CTXT_NEEDED, 19, 1)
 /* For M profile only, set if FPCCR.S does not match current security state */
 FIELD(TBFLAG_A32, FPCCR_S_WRONG, 20, 1)
 /* For M profile only, Handler (ie not Thread) mode */
diff --git a/target/arm/translate.h b/target/arm/translate.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.h
+++ b/target/arm/translate.h
@@ -XXX,XX +XXX,XX @@ typedef struct DisasContext {
     bool v8m_secure; /* true if v8M and we're in Secure mode */
     bool v8m_stackcheck; /* true if we need to perform v8M stack limit checks */
     bool v8m_fpccr_s_wrong; /* true if v8M FPCCR.S != v8m_secure */
+    bool v7m_new_fp_ctxt_needed; /* ASPEN set but no active FP context */
     /* Immediate value in AArch32 SVC insn; must be set if is_jmp == DISAS_SWI
      * so that top level loop can generate correct syndrome information.
      */
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void cpu_get_tb_cpu_state(CPUARMState *env, target_ulong *pc,
         flags = FIELD_DP32(flags, TBFLAG_A32, FPCCR_S_WRONG, 1);
     }
 
+    if (arm_feature(env, ARM_FEATURE_M) &&
+        (env->v7m.fpccr[env->v7m.secure] & R_V7M_FPCCR_ASPEN_MASK) &&
+        (!(env->v7m.control[M_REG_S] & R_V7M_CONTROL_FPCA_MASK) ||
+         (env->v7m.secure &&
+          !(env->v7m.control[M_REG_S] & R_V7M_CONTROL_SFPA_MASK)))) {
+        /*
+         * ASPEN is set, but FPCA/SFPA indicate that there is no active
+         * FP context; we must create a new FP context before executing
+         * any FP insn.
+         */
+        flags = FIELD_DP32(flags, TBFLAG_A32, NEW_FP_CTXT_NEEDED, 1);
+    }
+
     *pflags = flags;
     *cs_base = 0;
 }
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_vfp_insn(DisasContext *s, uint32_t insn)
             /* Don't need to do this for any further FP insns in this TB */
             s->v8m_fpccr_s_wrong = false;
         }
+
+        if (s->v7m_new_fp_ctxt_needed) {
+            /*
+             * Create new FP context by updating CONTROL.FPCA, CONTROL.SFPA
+             * and the FPSCR.
+             */
+            TCGv_i32 control, fpscr;
+            uint32_t bits = R_V7M_CONTROL_FPCA_MASK;
+
+            fpscr = load_cpu_field(v7m.fpdscr[s->v8m_secure]);
+            gen_helper_vfp_set_fpscr(cpu_env, fpscr);
+            tcg_temp_free_i32(fpscr);
+            /*
+             * We don't need to arrange to end the TB, because the only
+             * parts of FPSCR which we cache in the TB flags are the VECLEN
+             * and VECSTRIDE, and those don't exist for M-profile.
+             */
+
+            if (s->v8m_secure) {
+                bits |= R_V7M_CONTROL_SFPA_MASK;
+            }
+            control = load_cpu_field(v7m.control[M_REG_S]);
+            tcg_gen_ori_i32(control, control, bits);
+            store_cpu_field(control, v7m.control[M_REG_S]);
+            /* Don't need to do this for any further FP insns in this TB */
+            s->v7m_new_fp_ctxt_needed = false;
+        }
     }
 
     if (extract32(insn, 28, 4) == 0xf) {
@@ -XXX,XX +XXX,XX @@ static void arm_tr_init_disas_context(DisasContextBase *dcbase, CPUState *cs)
         regime_is_secure(env, dc->mmu_idx);
     dc->v8m_stackcheck = FIELD_EX32(tb_flags, TBFLAG_A32, STACKCHECK);
     dc->v8m_fpccr_s_wrong = FIELD_EX32(tb_flags, TBFLAG_A32, FPCCR_S_WRONG);
+    dc->v7m_new_fp_ctxt_needed =
+        FIELD_EX32(tb_flags, TBFLAG_A32, NEW_FP_CTXT_NEEDED);
     dc->cp_regs = cpu->cp_regs;
     dc->features = env->features;
 
-- 
2.20.1

Add a new helper function which returns the MMU index to use
for v7M, where the caller specifies all of the security
state, privilege level and whether the execution priority
is negative, and reimplement the existing
arm_v7m_mmu_idx_for_secstate_and_priv() in terms of it.

We are going to need this for the lazy-FP-stacking code.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-21-peter.maydell@linaro.org
---
 target/arm/cpu.h    |  7 +++++++
 target/arm/helper.c | 14 +++++++++++---
 2 files changed, 18 insertions(+), 3 deletions(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ static inline int arm_mmu_idx_to_el(ARMMMUIdx mmu_idx)
     }
 }
 
+/*
+ * Return the MMU index for a v7M CPU with all relevant information
+ * manually specified.
+ */
+ARMMMUIdx arm_v7m_mmu_idx_all(CPUARMState *env,
+                              bool secstate, bool priv, bool negpri);
+
 /* Return the MMU index for a v7M CPU in the specified security and
  * privilege state.
  */
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ int fp_exception_el(CPUARMState *env, int cur_el)
     return 0;
 }
 
-ARMMMUIdx arm_v7m_mmu_idx_for_secstate_and_priv(CPUARMState *env,
-                                                bool secstate, bool priv)
+ARMMMUIdx arm_v7m_mmu_idx_all(CPUARMState *env,
+                              bool secstate, bool priv, bool negpri)
 {
     ARMMMUIdx mmu_idx = ARM_MMU_IDX_M;
 
@@ -XXX,XX +XXX,XX @@ ARMMMUIdx arm_v7m_mmu_idx_for_secstate_and_priv(CPUARMState *env,
         mmu_idx |= ARM_MMU_IDX_M_PRIV;
     }
 
-    if (armv7m_nvic_neg_prio_requested(env->nvic, secstate)) {
+    if (negpri) {
         mmu_idx |= ARM_MMU_IDX_M_NEGPRI;
     }
 
@@ -XXX,XX +XXX,XX @@ ARMMMUIdx arm_v7m_mmu_idx_for_secstate_and_priv(CPUARMState *env,
     return mmu_idx;
 }
 
+ARMMMUIdx arm_v7m_mmu_idx_for_secstate_and_priv(CPUARMState *env,
+                                                bool secstate, bool priv)
+{
+    bool negpri = armv7m_nvic_neg_prio_requested(env->nvic, secstate);
+
+    return arm_v7m_mmu_idx_all(env, secstate, priv, negpri);
+}
+
 /* Return the MMU index for a v7M CPU in the specified security state */
 ARMMMUIdx arm_v7m_mmu_idx_for_secstate(CPUARMState *env, bool secstate)
 {
-- 
2.20.1

In the v7M architecture, if an exception is generated in the process
of doing the lazy stacking of FP registers, the handling of
possible escalation to HardFault is treated differently to the normal
approach: it works based on the saved information about exception
readiness that was stored in the FPCCR when the stack frame was
created. Provide a new function armv7m_nvic_set_pending_lazyfp()
which pends exceptions during lazy stacking, and implements
this logic.

This corresponds to the pseudocode TakePreserveFPException().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-22-peter.maydell@linaro.org
---
 target/arm/cpu.h      | 12 ++++++
 hw/intc/armv7m_nvic.c | 96 +++++++++++++++++++++++++++++++++++++++++++
 2 files changed, 108 insertions(+)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@ void armv7m_nvic_set_pending(void *opaque, int irq, bool secure);
  * a different exception).
  */
 void armv7m_nvic_set_pending_derived(void *opaque, int irq, bool secure);
+/**
+ * armv7m_nvic_set_pending_lazyfp: mark this lazy FP exception as pending
+ * @opaque: the NVIC
+ * @irq: the exception number to mark pending
+ * @secure: false for non-banked exceptions or for the nonsecure
+ * version of a banked exception, true for the secure version of a banked
+ * exception.
+ *
+ * Similar to armv7m_nvic_set_pending(), but specifically for exceptions
+ * generated in the course of lazy stacking of FP registers.
+ */
+void armv7m_nvic_set_pending_lazyfp(void *opaque, int irq, bool secure);
 /**
  * armv7m_nvic_get_pending_irq_info: return highest priority pending
  *    exception, and whether it targets Secure state
diff --git a/hw/intc/armv7m_nvic.c b/hw/intc/armv7m_nvic.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/intc/armv7m_nvic.c
+++ b/hw/intc/armv7m_nvic.c
@@ -XXX,XX +XXX,XX @@ void armv7m_nvic_set_pending_derived(void *opaque, int irq, bool secure)
     do_armv7m_nvic_set_pending(opaque, irq, secure, true);
 }
 
+void armv7m_nvic_set_pending_lazyfp(void *opaque, int irq, bool secure)
+{
+    /*
+     * Pend an exception during lazy FP stacking. This differs
+     * from the usual exception pending because the logic for
+     * whether we should escalate depends on the saved context
+     * in the FPCCR register, not on the current state of the CPU/NVIC.
+     */
+    NVICState *s = (NVICState *)opaque;
+    bool banked = exc_is_banked(irq);
+    VecInfo *vec;
+    bool targets_secure;
+    bool escalate = false;
+    /*
+     * We will only look at bits in fpccr if this is a banked exception
+     * (in which case 'secure' tells us whether it is the S or NS version).
+     * All the bits for the non-banked exceptions are in fpccr_s.
+     */
+    uint32_t fpccr_s = s->cpu->env.v7m.fpccr[M_REG_S];
+    uint32_t fpccr = s->cpu->env.v7m.fpccr[secure];
+
+    assert(irq > ARMV7M_EXCP_RESET && irq < s->num_irq);
+    assert(!secure || banked);
+
+    vec = (banked && secure) ? &s->sec_vectors[irq] : &s->vectors[irq];
+
+    targets_secure = banked ? secure : exc_targets_secure(s, irq);
+
+    switch (irq) {
+    case ARMV7M_EXCP_DEBUG:
+        if (!(fpccr_s & R_V7M_FPCCR_MONRDY_MASK)) {
+            /* Ignore DebugMonitor exception */
+            return;
+        }
+        break;
+    case ARMV7M_EXCP_MEM:
+        escalate = !(fpccr & R_V7M_FPCCR_MMRDY_MASK);
+        break;
+    case ARMV7M_EXCP_USAGE:
+        escalate = !(fpccr & R_V7M_FPCCR_UFRDY_MASK);
+        break;
+    case ARMV7M_EXCP_BUS:
+        escalate = !(fpccr_s & R_V7M_FPCCR_BFRDY_MASK);
+        break;
+    case ARMV7M_EXCP_SECURE:
+        escalate = !(fpccr_s & R_V7M_FPCCR_SFRDY_MASK);
+        break;
+    default:
+        g_assert_not_reached();
+    }
+
+    if (escalate) {
+        /*
+         * Escalate to HardFault: faults that initially targeted Secure
+         * continue to do so, even if HF normally targets NonSecure.
+         */
+        irq = ARMV7M_EXCP_HARD;
+        if (arm_feature(&s->cpu->env, ARM_FEATURE_M_SECURITY) &&
+            (targets_secure ||
+             !(s->cpu->env.v7m.aircr & R_V7M_AIRCR_BFHFNMINS_MASK))) {
+            vec = &s->sec_vectors[irq];
+        } else {
+            vec = &s->vectors[irq];
+        }
+    }
+
+    if (!vec->enabled ||
+        nvic_exec_prio(s) <= exc_group_prio(s, vec->prio, secure)) {
+        if (!(fpccr_s & R_V7M_FPCCR_HFRDY_MASK)) {
+            /*
+             * We want to escalate to HardFault but the context the
+             * FP state belongs to prevents the exception pre-empting.
+             */
+            cpu_abort(&s->cpu->parent_obj,
+                      "Lockup: can't escalate to HardFault during "
+                      "lazy FP register stacking\n");
+        }
+    }
+
+    if (escalate) {
+        s->cpu->env.v7m.hfsr |= R_V7M_HFSR_FORCED_MASK;
+    }
+    if (!vec->pending) {
+        vec->pending = 1;
+        /*
+         * We do not call nvic_irq_update(), because we know our caller
+         * is going to handle causing us to take the exception by
+         * raising EXCP_LAZYFP, so raising the IRQ line would be
+         * pointless extra work. We just need to recompute the
+         * priorities so that armv7m_nvic_can_take_pending_exception()
+         * returns the right answer.
+         */
+        nvic_recompute_state(s);
+    }
+}
+
 /* Make pending IRQ active.  */
 void armv7m_nvic_acknowledge_irq(void *opaque)
 {
-- 
2.20.1

Pushing registers to the stack for v7M needs to handle three cases:
 * the "normal" case where we pend exceptions
 * an "ignore faults" case where we set FSR bits but
   do not pend exceptions (this is used when we are
   handling some kinds of derived exception on exception entry)
 * a "lazy FP stacking" case, where different FSR bits
   are set and the exception is pended differently

Implement this by changing the existing flag argument that
tells us whether to ignore faults or not into an enum that
specifies which of the 3 modes we should handle.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-23-peter.maydell@linaro.org
---
 target/arm/helper.c | 118 +++++++++++++++++++++++++++++---------------
 1 file changed, 79 insertions(+), 39 deletions(-)

diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ static bool v7m_cpacr_pass(CPUARMState *env, bool is_secure, bool is_priv)
     }
 }
 
+/*
+ * What kind of stack write are we doing? This affects how exceptions
+ * generated during the stacking are treated.
+ */
+typedef enum StackingMode {
+    STACK_NORMAL,
+    STACK_IGNFAULTS,
+    STACK_LAZYFP,
+} StackingMode;
+
 static bool v7m_stack_write(ARMCPU *cpu, uint32_t addr, uint32_t value,
-                            ARMMMUIdx mmu_idx, bool ignfault)
+                            ARMMMUIdx mmu_idx, StackingMode mode)
 {
     CPUState *cs = CPU(cpu);
     CPUARMState *env = &cpu->env;
@@ -XXX,XX +XXX,XX @@ static bool v7m_stack_write(ARMCPU *cpu, uint32_t addr, uint32_t value,
                       &attrs, &prot, &page_size, &fi, NULL)) {
         /* MPU/SAU lookup failed */
         if (fi.type == ARMFault_QEMU_SFault) {
-            qemu_log_mask(CPU_LOG_INT,
-                          "...SecureFault with SFSR.AUVIOL during stacking\n");
-            env->v7m.sfsr |= R_V7M_SFSR_AUVIOL_MASK | R_V7M_SFSR_SFARVALID_MASK;
+            if (mode == STACK_LAZYFP) {
+                qemu_log_mask(CPU_LOG_INT,
+                              "...SecureFault with SFSR.LSPERR "
+                              "during lazy stacking\n");
+                env->v7m.sfsr |= R_V7M_SFSR_LSPERR_MASK;
+            } else {
+                qemu_log_mask(CPU_LOG_INT,
+                              "...SecureFault with SFSR.AUVIOL "
+                              "during stacking\n");
+                env->v7m.sfsr |= R_V7M_SFSR_AUVIOL_MASK;
+            }
+            env->v7m.sfsr |= R_V7M_SFSR_SFARVALID_MASK;
             env->v7m.sfar = addr;
             exc = ARMV7M_EXCP_SECURE;
             exc_secure = false;
         } else {
-            qemu_log_mask(CPU_LOG_INT, "...MemManageFault with CFSR.MSTKERR\n");
-            env->v7m.cfsr[secure] |= R_V7M_CFSR_MSTKERR_MASK;
+            if (mode == STACK_LAZYFP) {
+                qemu_log_mask(CPU_LOG_INT,
+                              "...MemManageFault with CFSR.MLSPERR\n");
+                env->v7m.cfsr[secure] |= R_V7M_CFSR_MLSPERR_MASK;
+            } else {
+                qemu_log_mask(CPU_LOG_INT,
+                              "...MemManageFault with CFSR.MSTKERR\n");
+                env->v7m.cfsr[secure] |= R_V7M_CFSR_MSTKERR_MASK;
+            }
             exc = ARMV7M_EXCP_MEM;
             exc_secure = secure;
         }
@@ -XXX,XX +XXX,XX @@ static bool v7m_stack_write(ARMCPU *cpu, uint32_t addr, uint32_t value,
                          attrs, &txres);
     if (txres != MEMTX_OK) {
         /* BusFault trying to write the data */
-        qemu_log_mask(CPU_LOG_INT, "...BusFault with BFSR.STKERR\n");
-        env->v7m.cfsr[M_REG_NS] |= R_V7M_CFSR_STKERR_MASK;
+        if (mode == STACK_LAZYFP) {
+            qemu_log_mask(CPU_LOG_INT, "...BusFault with BFSR.LSPERR\n");
+            env->v7m.cfsr[M_REG_NS] |= R_V7M_CFSR_LSPERR_MASK;
+        } else {
+            qemu_log_mask(CPU_LOG_INT, "...BusFault with BFSR.STKERR\n");
+            env->v7m.cfsr[M_REG_NS] |= R_V7M_CFSR_STKERR_MASK;
+        }
         exc = ARMV7M_EXCP_BUS;
         exc_secure = false;
         goto pend_fault;
@@ -XXX,XX +XXX,XX @@ pend_fault:
      * later if we have two derived exceptions.
      * The only case when we must not pend the exception but instead
      * throw it away is if we are doing the push of the callee registers
-     * and we've already generated a derived exception. Even in this
-     * case we will still update the fault status registers.
+     * and we've already generated a derived exception (this is indicated
+     * by the caller passing STACK_IGNFAULTS). Even in this case we will
+     * still update the fault status registers.
      */
-    if (!ignfault) {
+    switch (mode) {
+    case STACK_NORMAL:
         armv7m_nvic_set_pending_derived(env->nvic, exc, exc_secure);
+        break;
+    case STACK_LAZYFP:
+        armv7m_nvic_set_pending_lazyfp(env->nvic, exc, exc_secure);
+        break;
+    case STACK_IGNFAULTS:
+        break;
     }
     return false;
 }
@@ -XXX,XX +XXX,XX @@ static bool v7m_push_callee_stack(ARMCPU *cpu, uint32_t lr, bool dotailchain,
     uint32_t limit;
     bool want_psp;
     uint32_t sig;
+    StackingMode smode = ignore_faults ? STACK_IGNFAULTS : STACK_NORMAL;
 
     if (dotailchain) {
         bool mode = lr & R_V7M_EXCRET_MODE_MASK;
@@ -XXX,XX +XXX,XX @@ static bool v7m_push_callee_stack(ARMCPU *cpu, uint32_t lr, bool dotailchain,
      */
     sig = v7m_integrity_sig(env, lr);
     stacked_ok =
-        v7m_stack_write(cpu, frameptr, sig, mmu_idx, ignore_faults) &&
-        v7m_stack_write(cpu, frameptr + 0x8, env->regs[4], mmu_idx,
-                        ignore_faults) &&
-        v7m_stack_write(cpu, frameptr + 0xc, env->regs[5], mmu_idx,
-                        ignore_faults) &&
-        v7m_stack_write(cpu, frameptr + 0x10, env->regs[6], mmu_idx,
-                        ignore_faults) &&
-        v7m_stack_write(cpu, frameptr + 0x14, env->regs[7], mmu_idx,
-                        ignore_faults) &&
-        v7m_stack_write(cpu, frameptr + 0x18, env->regs[8], mmu_idx,
-                        ignore_faults) &&
-        v7m_stack_write(cpu, frameptr + 0x1c, env->regs[9], mmu_idx,
-                        ignore_faults) &&
-        v7m_stack_write(cpu, frameptr + 0x20, env->regs[10], mmu_idx,
-                        ignore_faults) &&
-        v7m_stack_write(cpu, frameptr + 0x24, env->regs[11], mmu_idx,
-                        ignore_faults);
+        v7m_stack_write(cpu, frameptr, sig, mmu_idx, smode) &&
+        v7m_stack_write(cpu, frameptr + 0x8, env->regs[4], mmu_idx, smode) &&
+        v7m_stack_write(cpu, frameptr + 0xc, env->regs[5], mmu_idx, smode) &&
+        v7m_stack_write(cpu, frameptr + 0x10, env->regs[6], mmu_idx, smode) &&
+        v7m_stack_write(cpu, frameptr + 0x14, env->regs[7], mmu_idx, smode) &&
+        v7m_stack_write(cpu, frameptr + 0x18, env->regs[8], mmu_idx, smode) &&
+        v7m_stack_write(cpu, frameptr + 0x1c, env->regs[9], mmu_idx, smode) &&
+        v7m_stack_write(cpu, frameptr + 0x20, env->regs[10], mmu_idx, smode) &&
+        v7m_stack_write(cpu, frameptr + 0x24, env->regs[11], mmu_idx, smode);
 
     /* Update SP regardless of whether any of the stack accesses failed. */
     *frame_sp_p = frameptr;
@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
      * if it has higher priority).
      */
     stacked_ok = stacked_ok &&
-        v7m_stack_write(cpu, frameptr, env->regs[0], mmu_idx, false) &&
-        v7m_stack_write(cpu, frameptr + 4, env->regs[1], mmu_idx, false) &&
-        v7m_stack_write(cpu, frameptr + 8, env->regs[2], mmu_idx, false) &&
-        v7m_stack_write(cpu, frameptr + 12, env->regs[3], mmu_idx, false) &&
-        v7m_stack_write(cpu, frameptr + 16, env->regs[12], mmu_idx, false) &&
-        v7m_stack_write(cpu, frameptr + 20, env->regs[14], mmu_idx, false) &&
-        v7m_stack_write(cpu, frameptr + 24, env->regs[15], mmu_idx, false) &&
-        v7m_stack_write(cpu, frameptr + 28, xpsr, mmu_idx, false);
+        v7m_stack_write(cpu, frameptr, env->regs[0], mmu_idx, STACK_NORMAL) &&
+        v7m_stack_write(cpu, frameptr + 4, env->regs[1],
+                        mmu_idx, STACK_NORMAL) &&
+        v7m_stack_write(cpu, frameptr + 8, env->regs[2],
+                        mmu_idx, STACK_NORMAL) &&
+        v7m_stack_write(cpu, frameptr + 12, env->regs[3],
+                        mmu_idx, STACK_NORMAL) &&
+        v7m_stack_write(cpu, frameptr + 16, env->regs[12],
+                        mmu_idx, STACK_NORMAL) &&
+        v7m_stack_write(cpu, frameptr + 20, env->regs[14],
+                        mmu_idx, STACK_NORMAL) &&
+        v7m_stack_write(cpu, frameptr + 24, env->regs[15],
+                        mmu_idx, STACK_NORMAL) &&
+        v7m_stack_write(cpu, frameptr + 28, xpsr, mmu_idx, STACK_NORMAL);
 
     if (env->v7m.control[M_REG_S] & R_V7M_CONTROL_FPCA_MASK) {
         /* FPU is active, try to save its registers */
@@ -XXX,XX +XXX,XX @@ static bool v7m_push_stack(ARMCPU *cpu)
                         faddr += 8; /* skip the slot for the FPSCR */
                     }
                     stacked_ok = stacked_ok &&
-                        v7m_stack_write(cpu, faddr, slo, mmu_idx, false) &&
-                        v7m_stack_write(cpu, faddr + 4, shi, mmu_idx, false);
+                        v7m_stack_write(cpu, faddr, slo,
+                                        mmu_idx, STACK_NORMAL) &&
+                        v7m_stack_write(cpu, faddr + 4, shi,
+                                        mmu_idx, STACK_NORMAL);
                 }
                 stacked_ok = stacked_ok &&
                     v7m_stack_write(cpu, frameptr + 0x60,
-                                    vfp_get_fpscr(env), mmu_idx, false);
+                                    vfp_get_fpscr(env), mmu_idx, STACK_NORMAL);
                 if (cpacr_pass) {
                     for (i = 0; i < ((framesize == 0xa8) ? 32 : 16); i += 2) {
                         *aa32_vfp_dreg(env, i / 2) = 0;
-- 
2.20.1

The M-profile architecture floating point system supports
lazy FP state preservation, where FP registers are not
pushed to the stack when an exception occurs but are instead
only saved if and when the first FP instruction in the exception
handler is executed. Implement this in QEMU, corresponding
to the check of LSPACT in the pseudocode ExecuteFPCheck().

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-24-peter.maydell@linaro.org
---
 target/arm/cpu.h       |   3 ++
 target/arm/helper.h    |   2 +
 target/arm/translate.h |   1 +
 target/arm/helper.c    | 112 +++++++++++++++++++++++++++++++++++++++++
 target/arm/translate.c |  22 ++++++++
 5 files changed, 140 insertions(+)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@
 #define EXCP_NOCP           17   /* v7M NOCP UsageFault */
 #define EXCP_INVSTATE       18   /* v7M INVSTATE UsageFault */
 #define EXCP_STKOF          19   /* v8M STKOF UsageFault */
+#define EXCP_LAZYFP         20   /* v7M fault during lazy FP stacking */
 /* NB: add new EXCP_ defines to the array in arm_log_exception() too */
 
 #define ARMV7M_EXCP_RESET   1
@@ -XXX,XX +XXX,XX @@ FIELD(TBFLAG_A32, NS, 6, 1)
 FIELD(TBFLAG_A32, VFPEN, 7, 1)
 FIELD(TBFLAG_A32, CONDEXEC, 8, 8)
 FIELD(TBFLAG_A32, SCTLR_B, 16, 1)
+/* For M profile only, set if FPCCR.LSPACT is set */
+FIELD(TBFLAG_A32, LSPACT, 18, 1)
 /* For M profile only, set if we must create a new FP context */
 FIELD(TBFLAG_A32, NEW_FP_CTXT_NEEDED, 19, 1)
 /* For M profile only, set if FPCCR.S does not match current security state */
diff --git a/target/arm/helper.h b/target/arm/helper.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.h
+++ b/target/arm/helper.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_2(v7m_blxns, void, env, i32)
 
 DEF_HELPER_3(v7m_tt, i32, env, i32, i32)
 
+DEF_HELPER_1(v7m_preserve_fp_state, void, env)
+
 DEF_HELPER_2(v8m_stackcheck, void, env, i32)
 
 DEF_HELPER_4(access_check_cp_reg, void, env, ptr, i32, i32)
diff --git a/target/arm/translate.h b/target/arm/translate.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.h
+++ b/target/arm/translate.h
@@ -XXX,XX +XXX,XX @@ typedef struct DisasContext {
     bool v8m_stackcheck; /* true if we need to perform v8M stack limit checks */
     bool v8m_fpccr_s_wrong; /* true if v8M FPCCR.S != v8m_secure */
     bool v7m_new_fp_ctxt_needed; /* ASPEN set but no active FP context */
+    bool v7m_lspact; /* FPCCR.LSPACT set */
     /* Immediate value in AArch32 SVC insn; must be set if is_jmp == DISAS_SWI
      * so that top level loop can generate correct syndrome information.
      */
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_blxns)(CPUARMState *env, uint32_t dest)
     g_assert_not_reached();
 }
 
+void HELPER(v7m_preserve_fp_state)(CPUARMState *env)
+{
+    /* translate.c should never generate calls here in user-only mode */
+    g_assert_not_reached();
+}
+
 uint32_t HELPER(v7m_tt)(CPUARMState *env, uint32_t addr, uint32_t op)
 {
     /* The TT instructions can be used by unprivileged code, but in
@@ -XXX,XX +XXX,XX @@ pend_fault:
     return false;
 }
 
+void HELPER(v7m_preserve_fp_state)(CPUARMState *env)
+{
+    /*
+     * Preserve FP state (because LSPACT was set and we are about
+     * to execute an FP instruction). This corresponds to the
+     * PreserveFPState() pseudocode.
+     * We may throw an exception if the stacking fails.
+     */
+    ARMCPU *cpu = arm_env_get_cpu(env);
+    bool is_secure = env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_S_MASK;
+    bool negpri = !(env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_HFRDY_MASK);
+    bool is_priv = !(env->v7m.fpccr[is_secure] & R_V7M_FPCCR_USER_MASK);
+    bool splimviol = env->v7m.fpccr[is_secure] & R_V7M_FPCCR_SPLIMVIOL_MASK;
+    uint32_t fpcar = env->v7m.fpcar[is_secure];
+    bool stacked_ok = true;
+    bool ts = is_secure && (env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_TS_MASK);
+    bool take_exception;
+
+    /* Take the iothread lock as we are going to touch the NVIC */
+    qemu_mutex_lock_iothread();
+
+    /* Check the background context had access to the FPU */
+    if (!v7m_cpacr_pass(env, is_secure, is_priv)) {
+        armv7m_nvic_set_pending_lazyfp(env->nvic, ARMV7M_EXCP_USAGE, is_secure);
+        env->v7m.cfsr[is_secure] |= R_V7M_CFSR_NOCP_MASK;
+        stacked_ok = false;
+    } else if (!is_secure && !extract32(env->v7m.nsacr, 10, 1)) {
+        armv7m_nvic_set_pending_lazyfp(env->nvic, ARMV7M_EXCP_USAGE, M_REG_S);
+        env->v7m.cfsr[M_REG_S] |= R_V7M_CFSR_NOCP_MASK;
+        stacked_ok = false;
+    }
+
+    if (!splimviol && stacked_ok) {
+        /* We only stack if the stack limit wasn't violated */
+        int i;
+        ARMMMUIdx mmu_idx;
+
+        mmu_idx = arm_v7m_mmu_idx_all(env, is_secure, is_priv, negpri);
+        for (i = 0; i < (ts ? 32 : 16); i += 2) {
+            uint64_t dn = *aa32_vfp_dreg(env, i / 2);
+            uint32_t faddr = fpcar + 4 * i;
+            uint32_t slo = extract64(dn, 0, 32);
+            uint32_t shi = extract64(dn, 32, 32);
+
+            if (i >= 16) {
+                faddr += 8; /* skip the slot for the FPSCR */
+            }
+            stacked_ok = stacked_ok &&
+                v7m_stack_write(cpu, faddr, slo, mmu_idx, STACK_LAZYFP) &&
+                v7m_stack_write(cpu, faddr + 4, shi, mmu_idx, STACK_LAZYFP);
+        }
+
+        stacked_ok = stacked_ok &&
+            v7m_stack_write(cpu, fpcar + 0x40,
+                            vfp_get_fpscr(env), mmu_idx, STACK_LAZYFP);
+    }
+
+    /*
+     * We definitely pended an exception, but it's possible that it
+     * might not be able to be taken now. If its priority permits us
+     * to take it now, then we must not update the LSPACT or FP regs,
+     * but instead jump out to take the exception immediately.
+     * If it's just pending and won't be taken until the current
+     * handler exits, then we do update LSPACT and the FP regs.
+     */
+    take_exception = !stacked_ok &&
+        armv7m_nvic_can_take_pending_exception(env->nvic);
+
+    qemu_mutex_unlock_iothread();
+
+    if (take_exception) {
+        raise_exception_ra(env, EXCP_LAZYFP, 0, 1, GETPC());
+    }
+
+    env->v7m.fpccr[is_secure] &= ~R_V7M_FPCCR_LSPACT_MASK;
+
+    if (ts) {
+        /* Clear s0 to s31 and the FPSCR */
+        int i;
+
+        for (i = 0; i < 32; i += 2) {
+            *aa32_vfp_dreg(env, i / 2) = 0;
+        }
+        vfp_set_fpscr(env, 0);
+    }
+    /*
+     * Otherwise s0 to s15 and FPSCR are UNKNOWN; we choose to leave them
+     * unchanged.
+     */
+}
+
 /* Write to v7M CONTROL.SPSEL bit for the specified security bank.
  * This may change the current stack pointer between Main and Process
  * stack pointers if it is done for the CONTROL register for the current
@@ -XXX,XX +XXX,XX @@ static void arm_log_exception(int idx)
             [EXCP_NOCP] = "v7M NOCP UsageFault",
             [EXCP_INVSTATE] = "v7M INVSTATE UsageFault",
             [EXCP_STKOF] = "v8M STKOF UsageFault",
+            [EXCP_LAZYFP] = "v7M exception during lazy FP stacking",
         };
 
         if (idx >= 0 && idx < ARRAY_SIZE(excnames)) {
@@ -XXX,XX +XXX,XX @@ void arm_v7m_cpu_do_interrupt(CPUState *cs)
             return;
         }
         break;
+    case EXCP_LAZYFP:
+        /*
+         * We already pended the specific exception in the NVIC in the
+         * v7m_preserve_fp_state() helper function.
+         */
+        break;
     default:
         cpu_abort(cs, "Unhandled exception 0x%x\n", cs->exception_index);
         return; /* Never happens.  Keep compiler happy.  */
@@ -XXX,XX +XXX,XX @@ void cpu_get_tb_cpu_state(CPUARMState *env, target_ulong *pc,
         flags = FIELD_DP32(flags, TBFLAG_A32, NEW_FP_CTXT_NEEDED, 1);
     }
 
+    if (arm_feature(env, ARM_FEATURE_M)) {
+        bool is_secure = env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_S_MASK;
+
+        if (env->v7m.fpccr[is_secure] & R_V7M_FPCCR_LSPACT_MASK) {
+            flags = FIELD_DP32(flags, TBFLAG_A32, LSPACT, 1);
+        }
+    }
+
     *pflags = flags;
     *cs_base = 0;
 }
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static int disas_vfp_insn(DisasContext *s, uint32_t insn)
     if (arm_dc_feature(s, ARM_FEATURE_M)) {
         /* Handle M-profile lazy FP state mechanics */
 
+        /* Trigger lazy-state preservation if necessary */
+        if (s->v7m_lspact) {
+            /*
+             * Lazy state saving affects external memory and also the NVIC,
+             * so we must mark it as an IO operation for icount.
+             */
+            if (tb_cflags(s->base.tb) & CF_USE_ICOUNT) {
+                gen_io_start();
+            }
+            gen_helper_v7m_preserve_fp_state(cpu_env);
+            if (tb_cflags(s->base.tb) & CF_USE_ICOUNT) {
+                gen_io_end();
+            }
+            /*
+             * If the preserve_fp_state helper doesn't throw an exception
+             * then it will clear LSPACT; we don't need to repeat this for
+             * any further FP insns in this TB.
+             */
+            s->v7m_lspact = false;
+        }
+
         /* Update ownership of FP context: set FPCCR.S to match current state */
         if (s->v8m_fpccr_s_wrong) {
             TCGv_i32 tmp;
@@ -XXX,XX +XXX,XX @@ static void arm_tr_init_disas_context(DisasContextBase *dcbase, CPUState *cs)
     dc->v8m_fpccr_s_wrong = FIELD_EX32(tb_flags, TBFLAG_A32, FPCCR_S_WRONG);
     dc->v7m_new_fp_ctxt_needed =
         FIELD_EX32(tb_flags, TBFLAG_A32, NEW_FP_CTXT_NEEDED);
+    dc->v7m_lspact = FIELD_EX32(tb_flags, TBFLAG_A32, LSPACT);
     dc->cp_regs = cpu->cp_regs;
     dc->features = env->features;
 
-- 
2.20.1

Implement the VLSTM instruction for v7M for the FPU present case.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-25-peter.maydell@linaro.org
---
 target/arm/cpu.h       |  2 +
 target/arm/helper.h    |  2 +
 target/arm/helper.c    | 84 ++++++++++++++++++++++++++++++++++++++++++
 target/arm/translate.c | 15 +++++++-
 4 files changed, 102 insertions(+), 1 deletion(-)

diff --git a/target/arm/cpu.h b/target/arm/cpu.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.h
+++ b/target/arm/cpu.h
@@ -XXX,XX +XXX,XX @@
 #define EXCP_INVSTATE       18   /* v7M INVSTATE UsageFault */
 #define EXCP_STKOF          19   /* v8M STKOF UsageFault */
 #define EXCP_LAZYFP         20   /* v7M fault during lazy FP stacking */
+#define EXCP_LSERR          21   /* v8M LSERR SecureFault */
+#define EXCP_UNALIGNED      22   /* v7M UNALIGNED UsageFault */
 /* NB: add new EXCP_ defines to the array in arm_log_exception() too */
 
 #define ARMV7M_EXCP_RESET   1
diff --git a/target/arm/helper.h b/target/arm/helper.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.h
+++ b/target/arm/helper.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_3(v7m_tt, i32, env, i32, i32)
 
 DEF_HELPER_1(v7m_preserve_fp_state, void, env)
 
+DEF_HELPER_2(v7m_vlstm, void, env, i32)
+
 DEF_HELPER_2(v8m_stackcheck, void, env, i32)
 
 DEF_HELPER_4(access_check_cp_reg, void, env, ptr, i32, i32)
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_preserve_fp_state)(CPUARMState *env)
     g_assert_not_reached();
 }
 
+void HELPER(v7m_vlstm)(CPUARMState *env, uint32_t fptr)
+{
+    /* translate.c should never generate calls here in user-only mode */
+    g_assert_not_reached();
+}
+
 uint32_t HELPER(v7m_tt)(CPUARMState *env, uint32_t addr, uint32_t op)
 {
     /* The TT instructions can be used by unprivileged code, but in
@@ -XXX,XX +XXX,XX @@ static void v7m_update_fpccr(CPUARMState *env, uint32_t frameptr,
     }
 }
 
+void HELPER(v7m_vlstm)(CPUARMState *env, uint32_t fptr)
+{
+    /* fptr is the value of Rn, the frame pointer we store the FP regs to */
+    bool s = env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_S_MASK;
+    bool lspact = env->v7m.fpccr[s] & R_V7M_FPCCR_LSPACT_MASK;
+
+    assert(env->v7m.secure);
+
+    if (!(env->v7m.control[M_REG_S] & R_V7M_CONTROL_SFPA_MASK)) {
+        return;
+    }
+
+    /* Check access to the coprocessor is permitted */
+    if (!v7m_cpacr_pass(env, true, arm_current_el(env) != 0)) {
+        raise_exception_ra(env, EXCP_NOCP, 0, 1, GETPC());
+    }
+
+    if (lspact) {
+        /* LSPACT should not be active when there is active FP state */
+        raise_exception_ra(env, EXCP_LSERR, 0, 1, GETPC());
+    }
+
+    if (fptr & 7) {
+        raise_exception_ra(env, EXCP_UNALIGNED, 0, 1, GETPC());
+    }
+
+    /*
+     * Note that we do not use v7m_stack_write() here, because the
+     * accesses should not set the FSR bits for stacking errors if they
+     * fail. (In pseudocode terms, they are AccType_NORMAL, not AccType_STACK
+     * or AccType_LAZYFP). Faults in cpu_stl_data() will throw exceptions
+     * and longjmp out.
+     */
+    if (!(env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_LSPEN_MASK)) {
+        bool ts = env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_TS_MASK;
+        int i;
+
+        for (i = 0; i < (ts ? 32 : 16); i += 2) {
+            uint64_t dn = *aa32_vfp_dreg(env, i / 2);
+            uint32_t faddr = fptr + 4 * i;
+            uint32_t slo = extract64(dn, 0, 32);
+            uint32_t shi = extract64(dn, 32, 32);
+
+            if (i >= 16) {
+                faddr += 8; /* skip the slot for the FPSCR */
+            }
+            cpu_stl_data(env, faddr, slo);
+            cpu_stl_data(env, faddr + 4, shi);
+        }
+        cpu_stl_data(env, fptr + 0x40, vfp_get_fpscr(env));
+
+        /*
+         * If TS is 0 then s0 to s15 and FPSCR are UNKNOWN; we choose to
+         * leave them unchanged, matching our choice in v7m_preserve_fp_state.
+         */
+        if (ts) {
+            for (i = 0; i < 32; i += 2) {
+                *aa32_vfp_dreg(env, i / 2) = 0;
+            }
+            vfp_set_fpscr(env, 0);
+        }
+    } else {
+        v7m_update_fpccr(env, fptr, false);
+    }
+
+    env->v7m.control[M_REG_S] &= ~R_V7M_CONTROL_FPCA_MASK;
+}
+
 static bool v7m_push_stack(ARMCPU *cpu)
 {
     /* Do the "set up stack frame" part of exception entry,
@@ -XXX,XX +XXX,XX @@ static void arm_log_exception(int idx)
             [EXCP_INVSTATE] = "v7M INVSTATE UsageFault",
             [EXCP_STKOF] = "v8M STKOF UsageFault",
             [EXCP_LAZYFP] = "v7M exception during lazy FP stacking",
+            [EXCP_LSERR] = "v8M LSERR UsageFault",
+            [EXCP_UNALIGNED] = "v7M UNALIGNED UsageFault",
         };
 
         if (idx >= 0 && idx < ARRAY_SIZE(excnames)) {
@@ -XXX,XX +XXX,XX @@ void arm_v7m_cpu_do_interrupt(CPUState *cs)
         armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE, env->v7m.secure);
         env->v7m.cfsr[env->v7m.secure] |= R_V7M_CFSR_STKOF_MASK;
         break;
+    case EXCP_LSERR:
+        armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_SECURE, false);
+        env->v7m.sfsr |= R_V7M_SFSR_LSERR_MASK;
+        break;
+    case EXCP_UNALIGNED:
+        armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_USAGE, env->v7m.secure);
+        env->v7m.cfsr[env->v7m.secure] |= R_V7M_CFSR_UNALIGNED_MASK;
+        break;
     case EXCP_SWI:
         /* The PC already points to the next instruction.  */
         armv7m_nvic_set_pending(env->nvic, ARMV7M_EXCP_SVC, env->v7m.secure);
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void disas_thumb2_insn(DisasContext *s, uint32_t insn)
                 if (!s->v8m_secure || (insn & 0x0040f0ff)) {
                     goto illegal_op;
                 }
-                /* Just NOP since FP support is not implemented */
+
+                if (arm_dc_feature(s, ARM_FEATURE_VFP)) {
+                    TCGv_i32 fptr = load_reg(s, rn);
+
+                    if (extract32(insn, 20, 1)) {
+                        /* VLLDM */
+                    } else {
+                        gen_helper_v7m_vlstm(cpu_env, fptr);
+                    }
+                    tcg_temp_free_i32(fptr);
+
+                    /* End the TB, because we have updated FP control bits */
+                    s->base.is_jmp = DISAS_UPDATE;
+                }
                 break;
             }
             if (arm_dc_feature(s, ARM_FEATURE_VFP) &&
-- 
2.20.1

Implement the VLLDM instruction for v7M for the FPU present cas.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-26-peter.maydell@linaro.org
---
 target/arm/helper.h    |  1 +
 target/arm/helper.c    | 54 ++++++++++++++++++++++++++++++++++++++++++
 target/arm/translate.c |  2 +-
 3 files changed, 56 insertions(+), 1 deletion(-)

diff --git a/target/arm/helper.h b/target/arm/helper.h
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.h
+++ b/target/arm/helper.h
@@ -XXX,XX +XXX,XX @@ DEF_HELPER_3(v7m_tt, i32, env, i32, i32)
 DEF_HELPER_1(v7m_preserve_fp_state, void, env)
 
 DEF_HELPER_2(v7m_vlstm, void, env, i32)
+DEF_HELPER_2(v7m_vlldm, void, env, i32)
 
 DEF_HELPER_2(v8m_stackcheck, void, env, i32)
 
diff --git a/target/arm/helper.c b/target/arm/helper.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/helper.c
+++ b/target/arm/helper.c
@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_vlstm)(CPUARMState *env, uint32_t fptr)
     g_assert_not_reached();
 }
 
+void HELPER(v7m_vlldm)(CPUARMState *env, uint32_t fptr)
+{
+    /* translate.c should never generate calls here in user-only mode */
+    g_assert_not_reached();
+}
+
 uint32_t HELPER(v7m_tt)(CPUARMState *env, uint32_t addr, uint32_t op)
 {
     /* The TT instructions can be used by unprivileged code, but in
@@ -XXX,XX +XXX,XX @@ void HELPER(v7m_vlstm)(CPUARMState *env, uint32_t fptr)
     env->v7m.control[M_REG_S] &= ~R_V7M_CONTROL_FPCA_MASK;
 }
 
+void HELPER(v7m_vlldm)(CPUARMState *env, uint32_t fptr)
+{
+    /* fptr is the value of Rn, the frame pointer we load the FP regs from */
+    assert(env->v7m.secure);
+
+    if (!(env->v7m.control[M_REG_S] & R_V7M_CONTROL_SFPA_MASK)) {
+        return;
+    }
+
+    /* Check access to the coprocessor is permitted */
+    if (!v7m_cpacr_pass(env, true, arm_current_el(env) != 0)) {
+        raise_exception_ra(env, EXCP_NOCP, 0, 1, GETPC());
+    }
+
+    if (env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_LSPACT_MASK) {
+        /* State in FP is still valid */
+        env->v7m.fpccr[M_REG_S] &= ~R_V7M_FPCCR_LSPACT_MASK;
+    } else {
+        bool ts = env->v7m.fpccr[M_REG_S] & R_V7M_FPCCR_TS_MASK;
+        int i;
+        uint32_t fpscr;
+
+        if (fptr & 7) {
+            raise_exception_ra(env, EXCP_UNALIGNED, 0, 1, GETPC());
+        }
+
+        for (i = 0; i < (ts ? 32 : 16); i += 2) {
+            uint32_t slo, shi;
+            uint64_t dn;
+            uint32_t faddr = fptr + 4 * i;
+
+            if (i >= 16) {
+                faddr += 8; /* skip the slot for the FPSCR */
+            }
+
+            slo = cpu_ldl_data(env, faddr);
+            shi = cpu_ldl_data(env, faddr + 4);
+
+            dn = (uint64_t) shi << 32 | slo;
+            *aa32_vfp_dreg(env, i / 2) = dn;
+        }
+        fpscr = cpu_ldl_data(env, fptr + 0x40);
+        vfp_set_fpscr(env, fpscr);
+    }
+
+    env->v7m.control[M_REG_S] |= R_V7M_CONTROL_FPCA_MASK;
+}
+
 static bool v7m_push_stack(ARMCPU *cpu)
 {
     /* Do the "set up stack frame" part of exception entry,
diff --git a/target/arm/translate.c b/target/arm/translate.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/translate.c
+++ b/target/arm/translate.c
@@ -XXX,XX +XXX,XX @@ static void disas_thumb2_insn(DisasContext *s, uint32_t insn)
                     TCGv_i32 fptr = load_reg(s, rn);
 
                     if (extract32(insn, 20, 1)) {
-                        /* VLLDM */
+                        gen_helper_v7m_vlldm(cpu_env, fptr);
                     } else {
                         gen_helper_v7m_vlstm(cpu_env, fptr);
                     }
-- 
2.20.1

Enable the FPU by default for the Cortex-M4 and Cortex-M33.

Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
Reviewed-by: Richard Henderson <richard.henderson@linaro.org>
Message-id: 20190416125744.27770-27-peter.maydell@linaro.org
---
 target/arm/cpu.c | 8 ++++++++
 1 file changed, 8 insertions(+)

diff --git a/target/arm/cpu.c b/target/arm/cpu.c
index XXXXXXX..XXXXXXX 100644
--- a/target/arm/cpu.c
+++ b/target/arm/cpu.c
@@ -XXX,XX +XXX,XX @@ static void cortex_m4_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_M);
     set_feature(&cpu->env, ARM_FEATURE_M_MAIN);
     set_feature(&cpu->env, ARM_FEATURE_THUMB_DSP);
+    set_feature(&cpu->env, ARM_FEATURE_VFP4);
     cpu->midr = 0x410fc240; /* r0p0 */
     cpu->pmsav7_dregion = 8;
+    cpu->isar.mvfr0 = 0x10110021;
+    cpu->isar.mvfr1 = 0x11000011;
+    cpu->isar.mvfr2 = 0x00000000;
     cpu->id_pfr0 = 0x00000030;
     cpu->id_pfr1 = 0x00000200;
     cpu->id_dfr0 = 0x00100000;
@@ -XXX,XX +XXX,XX @@ static void cortex_m33_initfn(Object *obj)
     set_feature(&cpu->env, ARM_FEATURE_M_MAIN);
     set_feature(&cpu->env, ARM_FEATURE_M_SECURITY);
     set_feature(&cpu->env, ARM_FEATURE_THUMB_DSP);
+    set_feature(&cpu->env, ARM_FEATURE_VFP4);
     cpu->midr = 0x410fd213; /* r0p3 */
     cpu->pmsav7_dregion = 16;
     cpu->sau_sregion = 8;
+    cpu->isar.mvfr0 = 0x10110021;
+    cpu->isar.mvfr1 = 0x11000011;
+    cpu->isar.mvfr2 = 0x00000040;
     cpu->id_pfr0 = 0x00000030;
     cpu->id_pfr1 = 0x00000210;
     cpu->id_dfr0 = 0x00200000;
-- 
2.20.1

From: Philippe Mathieu-Daudé <philmd@redhat.com>

Reviewed-by: Thomas Huth <thuth@redhat.com>
Reviewed-by: Cédric Le Goater <clg@kaod.org>
Reviewed-by: Markus Armbruster <armbru@redhat.com>
Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Message-id: 20190412165416.7977-2-philmd@redhat.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/arm/aspeed.c | 13 +++++++++----
 1 file changed, 9 insertions(+), 4 deletions(-)

diff --git a/hw/arm/aspeed.c b/hw/arm/aspeed.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/aspeed.c
+++ b/hw/arm/aspeed.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/arm/aspeed_soc.h"
 #include "hw/boards.h"
 #include "hw/i2c/smbus_eeprom.h"
+#include "hw/misc/pca9552.h"
+#include "hw/misc/tmp105.h"
 #include "qemu/log.h"
 #include "sysemu/block-backend.h"
 #include "hw/loader.h"
@@ -XXX,XX +XXX,XX @@ static void ast2500_evb_i2c_init(AspeedBoardState *bmc)
                           eeprom_buf);
 
     /* The AST2500 EVB expects a LM75 but a TMP105 is compatible */
-    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 7), "tmp105", 0x4d);
+    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 7),
+                     TYPE_TMP105, 0x4d);
 
     /* The AST2500 EVB does not have an RTC. Let's pretend that one is
      * plugged on the I2C bus header */
@@ -XXX,XX +XXX,XX @@ static void witherspoon_bmc_i2c_init(AspeedBoardState *bmc)
     AspeedSoCState *soc = &bmc->soc;
     uint8_t *eeprom_buf = g_malloc0(8 * 1024);
 
-    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 3), "pca9552", 0x60);
+    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 3), TYPE_PCA9552,
+                     0x60);
 
     i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 4), "tmp423", 0x4c);
     i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 5), "tmp423", 0x4c);
 
     /* The Witherspoon expects a TMP275 but a TMP105 is compatible */
-    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 9), "tmp105", 0x4a);
+    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 9), TYPE_TMP105,
+                     0x4a);
 
     /* The witherspoon board expects Epson RX8900 I2C RTC but a ds1338 is
      * good enough */
@@ -XXX,XX +XXX,XX @@ static void witherspoon_bmc_i2c_init(AspeedBoardState *bmc)
 
     smbus_eeprom_init_one(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 11), 0x51,
                           eeprom_buf);
-    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 11), "pca9552",
+    i2c_create_slave(aspeed_i2c_get_bus(DEVICE(&soc->i2c), 11), TYPE_PCA9552,
                      0x60);
 }
 
-- 
2.20.1

From: Philippe Mathieu-Daudé <philmd@redhat.com>

Suggested-by: Markus Armbruster <armbru@redhat.com>
Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Message-id: 20190412165416.7977-3-philmd@redhat.com
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 hw/arm/nseries.c | 3 ++-
 1 file changed, 2 insertions(+), 1 deletion(-)

diff --git a/hw/arm/nseries.c b/hw/arm/nseries.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/nseries.c
+++ b/hw/arm/nseries.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/boards.h"
 #include "hw/i2c/i2c.h"
 #include "hw/devices.h"
+#include "hw/misc/tmp105.h"
 #include "hw/block/flash.h"
 #include "hw/hw.h"
 #include "hw/bt.h"
@@ -XXX,XX +XXX,XX @@ static void n8x0_i2c_setup(struct n800_s *s)
     qemu_register_powerdown_notifier(&n8x0_system_powerdown_notifier);
 
     /* Attach a TMP105 PM chip (A0 wired to ground) */
-    dev = i2c_create_slave(i2c, "tmp105", N8X0_TMP105_ADDR);
+    dev = i2c_create_slave(i2c, TYPE_TMP105, N8X0_TMP105_ADDR);
     qdev_connect_gpio_out(dev, 0, tmp_irq);
 }
 
-- 
2.20.1

From: Philippe Mathieu-Daudé <philmd@redhat.com>

No code used the tc6393xb_gpio_in_get() and tc6393xb_gpio_out_set()
functions since their introduction in commit 88d2c950b002. Time to
remove them.

Suggested-by: Markus Armbruster <armbru@redhat.com>
Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Message-id: 20190412165416.7977-4-philmd@redhat.com
Reviewed-by: Peter Maydell <peter.maydell@linaro.org>
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/devices.h  |  3 ---
 hw/display/tc6393xb.c | 16 ----------------
 2 files changed, 19 deletions(-)

diff --git a/include/hw/devices.h b/include/hw/devices.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/devices.h
+++ b/include/hw/devices.h
@@ -XXX,XX +XXX,XX @@ void retu_key_event(void *retu, int state);
 typedef struct TC6393xbState TC6393xbState;
 TC6393xbState *tc6393xb_init(struct MemoryRegion *sysmem,
                              uint32_t base, qemu_irq irq);
-void tc6393xb_gpio_out_set(TC6393xbState *s, int line,
-                    qemu_irq handler);
-qemu_irq *tc6393xb_gpio_in_get(TC6393xbState *s);
 qemu_irq tc6393xb_l3v_get(TC6393xbState *s);
 
 #endif
diff --git a/hw/display/tc6393xb.c b/hw/display/tc6393xb.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/display/tc6393xb.c
+++ b/hw/display/tc6393xb.c
@@ -XXX,XX +XXX,XX @@ struct TC6393xbState {
              blanked : 1;
 };
 
-qemu_irq *tc6393xb_gpio_in_get(TC6393xbState *s)
-{
-    return s->gpio_in;
-}
-
 static void tc6393xb_gpio_set(void *opaque, int line, int level)
 {
 //    TC6393xbState *s = opaque;
@@ -XXX,XX +XXX,XX @@ static void tc6393xb_gpio_set(void *opaque, int line, int level)
     // FIXME: how does the chip reflect the GPIO input level change?
 }
 
-void tc6393xb_gpio_out_set(TC6393xbState *s, int line,
-                    qemu_irq handler)
-{
-    if (line >= TC6393XB_GPIOS) {
-        fprintf(stderr, "TC6393xb: no GPIO pin %d\n", line);
-        return;
-    }
-
-    s->handler[line] = handler;
-}
-
 static void tc6393xb_gpio_handler_update(TC6393xbState *s)
 {
     uint32_t level, diff;
-- 
2.20.1

From: Philippe Mathieu-Daudé <philmd@redhat.com>

Reviewed-by: Markus Armbruster <armbru@redhat.com>
Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Message-id: 20190412165416.7977-5-philmd@redhat.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/devices.h          |  6 ------
 include/hw/display/tc6393xb.h | 24 ++++++++++++++++++++++++
 hw/arm/tosa.c                 |  2 +-
 hw/display/tc6393xb.c         |  2 +-
 MAINTAINERS                   |  1 +
 5 files changed, 27 insertions(+), 8 deletions(-)
 create mode 100644 include/hw/display/tc6393xb.h

diff --git a/include/hw/devices.h b/include/hw/devices.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/devices.h
+++ b/include/hw/devices.h
@@ -XXX,XX +XXX,XX @@ void *tahvo_init(qemu_irq irq, int betty);
 
 void retu_key_event(void *retu, int state);
 
-/* tc6393xb.c */
-typedef struct TC6393xbState TC6393xbState;
-TC6393xbState *tc6393xb_init(struct MemoryRegion *sysmem,
-                             uint32_t base, qemu_irq irq);
-qemu_irq tc6393xb_l3v_get(TC6393xbState *s);
-
 #endif
diff --git a/include/hw/display/tc6393xb.h b/include/hw/display/tc6393xb.h
new file mode 100644
index XXXXXXX..XXXXXXX
--- /dev/null
+++ b/include/hw/display/tc6393xb.h
@@ -XXX,XX +XXX,XX @@
+/*
+ * Toshiba TC6393XB I/O Controller.
+ * Found in Sharp Zaurus SL-6000 (tosa) or some
+ * Toshiba e-Series PDAs.
+ *
+ * Copyright (c) 2007 Hervé Poussineau
+ *
+ * This work is licensed under the terms of the GNU GPL, version 2 or later.
+ * See the COPYING file in the top-level directory.
+ */
+
+#ifndef HW_DISPLAY_TC6393XB_H
+#define HW_DISPLAY_TC6393XB_H
+
+#include "exec/memory.h"
+#include "hw/irq.h"
+
+typedef struct TC6393xbState TC6393xbState;
+
+TC6393xbState *tc6393xb_init(struct MemoryRegion *sysmem,
+                             uint32_t base, qemu_irq irq);
+qemu_irq tc6393xb_l3v_get(TC6393xbState *s);
+
+#endif
diff --git a/hw/arm/tosa.c b/hw/arm/tosa.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/tosa.c
+++ b/hw/arm/tosa.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/hw.h"
 #include "hw/arm/pxa.h"
 #include "hw/arm/arm.h"
-#include "hw/devices.h"
 #include "hw/arm/sharpsl.h"
 #include "hw/pcmcia.h"
 #include "hw/boards.h"
+#include "hw/display/tc6393xb.h"
 #include "hw/i2c/i2c.h"
 #include "hw/ssi/ssi.h"
 #include "hw/sysbus.h"
diff --git a/hw/display/tc6393xb.c b/hw/display/tc6393xb.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/display/tc6393xb.c
+++ b/hw/display/tc6393xb.c
@@ -XXX,XX +XXX,XX @@
 #include "qapi/error.h"
 #include "qemu/host-utils.h"
 #include "hw/hw.h"
-#include "hw/devices.h"
+#include "hw/display/tc6393xb.h"
 #include "hw/block/flash.h"
 #include "ui/console.h"
 #include "ui/pixel_ops.h"
diff --git a/MAINTAINERS b/MAINTAINERS
index XXXXXXX..XXXXXXX 100644
--- a/MAINTAINERS
+++ b/MAINTAINERS
@@ -XXX,XX +XXX,XX @@ F: hw/misc/mst_fpga.c
 F: hw/misc/max111x.c
 F: include/hw/arm/pxa.h
 F: include/hw/arm/sharpsl.h
+F: include/hw/display/tc6393xb.h
 
 SABRELITE / i.MX6
 M: Peter Maydell <peter.maydell@linaro.org>
-- 
2.20.1

From: Philippe Mathieu-Daudé <philmd@redhat.com>

Add an entries the Blizzard device in MAINTAINERS.

Reviewed-by: Thomas Huth <thuth@redhat.com>
Reviewed-by: Markus Armbruster <armbru@redhat.com>
Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Message-id: 20190412165416.7977-6-philmd@redhat.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/devices.h          |  7 -------
 include/hw/display/blizzard.h | 22 ++++++++++++++++++++++
 hw/arm/nseries.c              |  1 +
 hw/display/blizzard.c         |  2 +-
 MAINTAINERS                   |  2 ++
 5 files changed, 26 insertions(+), 8 deletions(-)
 create mode 100644 include/hw/display/blizzard.h

diff --git a/include/hw/devices.h b/include/hw/devices.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/devices.h
+++ b/include/hw/devices.h
@@ -XXX,XX +XXX,XX @@ void tsc2005_set_transform(void *opaque, MouseTransformInfo *info);
 /* stellaris_input.c */
 void stellaris_gamepad_init(int n, qemu_irq *irq, const int *keycode);
 
-/* blizzard.c */
-void *s1d13745_init(qemu_irq gpio_int);
-void s1d13745_write(void *opaque, int dc, uint16_t value);
-void s1d13745_write_block(void *opaque, int dc,
-                void *buf, size_t len, int pitch);
-uint16_t s1d13745_read(void *opaque, int dc);
-
 /* cbus.c */
 typedef struct {
     qemu_irq clk;
diff --git a/include/hw/display/blizzard.h b/include/hw/display/blizzard.h
new file mode 100644
index XXXXXXX..XXXXXXX
--- /dev/null
+++ b/include/hw/display/blizzard.h
@@ -XXX,XX +XXX,XX @@
+/*
+ * Epson S1D13744/S1D13745 (Blizzard/Hailstorm/Tornado) LCD/TV controller.
+ *
+ * Copyright (C) 2008 Nokia Corporation
+ * Written by Andrzej Zaborowski
+ *
+ * This work is licensed under the terms of the GNU GPL, version 2 or later.
+ * See the COPYING file in the top-level directory.
+ */
+
+#ifndef HW_DISPLAY_BLIZZARD_H
+#define HW_DISPLAY_BLIZZARD_H
+
+#include "hw/irq.h"
+
+void *s1d13745_init(qemu_irq gpio_int);
+void s1d13745_write(void *opaque, int dc, uint16_t value);
+void s1d13745_write_block(void *opaque, int dc,
+                          void *buf, size_t len, int pitch);
+uint16_t s1d13745_read(void *opaque, int dc);
+
+#endif
diff --git a/hw/arm/nseries.c b/hw/arm/nseries.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/nseries.c
+++ b/hw/arm/nseries.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/boards.h"
 #include "hw/i2c/i2c.h"
 #include "hw/devices.h"
+#include "hw/display/blizzard.h"
 #include "hw/misc/tmp105.h"
 #include "hw/block/flash.h"
 #include "hw/hw.h"
diff --git a/hw/display/blizzard.c b/hw/display/blizzard.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/display/blizzard.c
+++ b/hw/display/blizzard.c
@@ -XXX,XX +XXX,XX @@
 #include "qemu/osdep.h"
 #include "qemu-common.h"
 #include "ui/console.h"
-#include "hw/devices.h"
+#include "hw/display/blizzard.h"
 #include "ui/pixel_ops.h"
 
 typedef void (*blizzard_fn_t)(uint8_t *, const uint8_t *, unsigned int);
diff --git a/MAINTAINERS b/MAINTAINERS
index XXXXXXX..XXXXXXX 100644
--- a/MAINTAINERS
+++ b/MAINTAINERS
@@ -XXX,XX +XXX,XX @@ M: Peter Maydell <peter.maydell@linaro.org>
 L: qemu-arm@nongnu.org
 S: Odd Fixes
 F: hw/arm/nseries.c
+F: hw/display/blizzard.c
 F: hw/input/lm832x.c
 F: hw/input/tsc2005.c
 F: hw/misc/cbus.c
 F: hw/timer/twl92230.c
+F: include/hw/display/blizzard.h
 
 Palm
 M: Andrzej Zaborowski <balrogg@gmail.com>
-- 
2.20.1

From: Philippe Mathieu-Daudé <philmd@redhat.com>

Reviewed-by: Thomas Huth <thuth@redhat.com>
Reviewed-by: Markus Armbruster <armbru@redhat.com>
Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Message-id: 20190412165416.7977-7-philmd@redhat.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/devices.h   | 14 --------------
 include/hw/misc/cbus.h | 32 ++++++++++++++++++++++++++++++++
 hw/arm/nseries.c       |  1 +
 hw/misc/cbus.c         |  2 +-
 MAINTAINERS            |  1 +
 5 files changed, 35 insertions(+), 15 deletions(-)
 create mode 100644 include/hw/misc/cbus.h

diff --git a/include/hw/devices.h b/include/hw/devices.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/devices.h
+++ b/include/hw/devices.h
@@ -XXX,XX +XXX,XX @@ void tsc2005_set_transform(void *opaque, MouseTransformInfo *info);
 /* stellaris_input.c */
 void stellaris_gamepad_init(int n, qemu_irq *irq, const int *keycode);
 
-/* cbus.c */
-typedef struct {
-    qemu_irq clk;
-    qemu_irq dat;
-    qemu_irq sel;
-} CBus;
-CBus *cbus_init(qemu_irq dat_out);
-void cbus_attach(CBus *bus, void *slave_opaque);
-
-void *retu_init(qemu_irq irq, int vilma);
-void *tahvo_init(qemu_irq irq, int betty);
-
-void retu_key_event(void *retu, int state);
-
 #endif
diff --git a/include/hw/misc/cbus.h b/include/hw/misc/cbus.h
new file mode 100644
index XXXXXXX..XXXXXXX
--- /dev/null
+++ b/include/hw/misc/cbus.h
@@ -XXX,XX +XXX,XX @@
+/*
+ * CBUS three-pin bus and the Retu / Betty / Tahvo / Vilma / Avilma /
+ * Hinku / Vinku / Ahne / Pihi chips used in various Nokia platforms.
+ * Based on reverse-engineering of a linux driver.
+ *
+ * Copyright (C) 2008 Nokia Corporation
+ * Written by Andrzej Zaborowski
+ *
+ * This work is licensed under the terms of the GNU GPL, version 2 or later.
+ * See the COPYING file in the top-level directory.
+ */
+
+#ifndef HW_MISC_CBUS_H
+#define HW_MISC_CBUS_H
+
+#include "hw/irq.h"
+
+typedef struct {
+    qemu_irq clk;
+    qemu_irq dat;
+    qemu_irq sel;
+} CBus;
+
+CBus *cbus_init(qemu_irq dat_out);
+void cbus_attach(CBus *bus, void *slave_opaque);
+
+void *retu_init(qemu_irq irq, int vilma);
+void *tahvo_init(qemu_irq irq, int betty);
+
+void retu_key_event(void *retu, int state);
+
+#endif
diff --git a/hw/arm/nseries.c b/hw/arm/nseries.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/nseries.c
+++ b/hw/arm/nseries.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/i2c/i2c.h"
 #include "hw/devices.h"
 #include "hw/display/blizzard.h"
+#include "hw/misc/cbus.h"
 #include "hw/misc/tmp105.h"
 #include "hw/block/flash.h"
 #include "hw/hw.h"
diff --git a/hw/misc/cbus.c b/hw/misc/cbus.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/misc/cbus.c
+++ b/hw/misc/cbus.c
@@ -XXX,XX +XXX,XX @@
 #include "qemu/osdep.h"
 #include "hw/hw.h"
 #include "hw/irq.h"
-#include "hw/devices.h"
+#include "hw/misc/cbus.h"
 #include "sysemu/sysemu.h"
 
 //#define DEBUG
diff --git a/MAINTAINERS b/MAINTAINERS
index XXXXXXX..XXXXXXX 100644
--- a/MAINTAINERS
+++ b/MAINTAINERS
@@ -XXX,XX +XXX,XX @@ F: hw/input/tsc2005.c
 F: hw/misc/cbus.c
 F: hw/timer/twl92230.c
 F: include/hw/display/blizzard.h
+F: include/hw/misc/cbus.h
 
 Palm
 M: Andrzej Zaborowski <balrogg@gmail.com>
-- 
2.20.1

From: Philippe Mathieu-Daudé <philmd@redhat.com>

Reviewed-by: Markus Armbruster <armbru@redhat.com>
Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Message-id: 20190412165416.7977-8-philmd@redhat.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/devices.h       |  3 ---
 include/hw/input/gamepad.h | 19 +++++++++++++++++++
 hw/arm/stellaris.c         |  2 +-
 hw/input/stellaris_input.c |  2 +-
 MAINTAINERS                |  1 +
 5 files changed, 22 insertions(+), 5 deletions(-)
 create mode 100644 include/hw/input/gamepad.h

diff --git a/include/hw/devices.h b/include/hw/devices.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/devices.h
+++ b/include/hw/devices.h
@@ -XXX,XX +XXX,XX @@ void *tsc2005_init(qemu_irq pintdav);
 uint32_t tsc2005_txrx(void *opaque, uint32_t value, int len);
 void tsc2005_set_transform(void *opaque, MouseTransformInfo *info);
 
-/* stellaris_input.c */
-void stellaris_gamepad_init(int n, qemu_irq *irq, const int *keycode);
-
 #endif
diff --git a/include/hw/input/gamepad.h b/include/hw/input/gamepad.h
new file mode 100644
index XXXXXXX..XXXXXXX
--- /dev/null
+++ b/include/hw/input/gamepad.h
@@ -XXX,XX +XXX,XX @@
+/*
+ * Gamepad style buttons connected to IRQ/GPIO lines
+ *
+ * Copyright (c) 2007 CodeSourcery.
+ * Written by Paul Brook
+ *
+ * This work is licensed under the terms of the GNU GPL, version 2 or later.
+ * See the COPYING file in the top-level directory.
+ */
+
+#ifndef HW_INPUT_GAMEPAD_H
+#define HW_INPUT_GAMEPAD_H
+
+#include "hw/irq.h"
+
+/* stellaris_input.c */
+void stellaris_gamepad_init(int n, qemu_irq *irq, const int *keycode);
+
+#endif
diff --git a/hw/arm/stellaris.c b/hw/arm/stellaris.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/stellaris.c
+++ b/hw/arm/stellaris.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/sysbus.h"
 #include "hw/ssi/ssi.h"
 #include "hw/arm/arm.h"
-#include "hw/devices.h"
 #include "qemu/timer.h"
 #include "hw/i2c/i2c.h"
 #include "net/net.h"
@@ -XXX,XX +XXX,XX @@
 #include "sysemu/sysemu.h"
 #include "hw/arm/armv7m.h"
 #include "hw/char/pl011.h"
+#include "hw/input/gamepad.h"
 #include "hw/watchdog/cmsdk-apb-watchdog.h"
 #include "hw/misc/unimp.h"
 #include "cpu.h"
diff --git a/hw/input/stellaris_input.c b/hw/input/stellaris_input.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/input/stellaris_input.c
+++ b/hw/input/stellaris_input.c
@@ -XXX,XX +XXX,XX @@
  */
 #include "qemu/osdep.h"
 #include "hw/hw.h"
-#include "hw/devices.h"
+#include "hw/input/gamepad.h"
 #include "ui/console.h"
 
 typedef struct {
diff --git a/MAINTAINERS b/MAINTAINERS
index XXXXXXX..XXXXXXX 100644
--- a/MAINTAINERS
+++ b/MAINTAINERS
@@ -XXX,XX +XXX,XX @@ M: Peter Maydell <peter.maydell@linaro.org>
 L: qemu-arm@nongnu.org
 S: Maintained
 F: hw/*/stellaris*
+F: include/hw/input/gamepad.h
 
 Versatile Express
 M: Peter Maydell <peter.maydell@linaro.org>
-- 
2.20.1

From: Philippe Mathieu-Daudé <philmd@redhat.com>

Since uWireSlave is only used in this new header, there is no
need to expose it via "qemu/typedefs.h".

Reviewed-by: Markus Armbruster <armbru@redhat.com>
Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Message-id: 20190412165416.7977-9-philmd@redhat.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/arm/omap.h      |  6 +-----
 include/hw/devices.h       | 15 ---------------
 include/hw/input/tsc2xxx.h | 36 ++++++++++++++++++++++++++++++++++++
 include/qemu/typedefs.h    |  1 -
 hw/arm/nseries.c           |  2 +-
 hw/arm/palm.c              |  2 +-
 hw/input/tsc2005.c         |  2 +-
 hw/input/tsc210x.c         |  4 ++--
 MAINTAINERS                |  2 ++
 9 files changed, 44 insertions(+), 26 deletions(-)
 create mode 100644 include/hw/input/tsc2xxx.h

diff --git a/include/hw/arm/omap.h b/include/hw/arm/omap.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/arm/omap.h
+++ b/include/hw/arm/omap.h
@@ -XXX,XX +XXX,XX @@
 #include "exec/memory.h"
 # define hw_omap_h		"omap.h"
 #include "hw/irq.h"
+#include "hw/input/tsc2xxx.h"
 #include "target/arm/cpu-qom.h"
 #include "qemu/log.h"
 
@@ -XXX,XX +XXX,XX @@ qemu_irq *omap_mpuio_in_get(struct omap_mpuio_s *s);
 void omap_mpuio_out_set(struct omap_mpuio_s *s, int line, qemu_irq handler);
 void omap_mpuio_key(struct omap_mpuio_s *s, int row, int col, int down);
 
-struct uWireSlave {
-    uint16_t (*receive)(void *opaque);
-    void (*send)(void *opaque, uint16_t data);
-    void *opaque;
-};
 struct omap_uwire_s;
 void omap_uwire_attach(struct omap_uwire_s *s,
                 uWireSlave *slave, int chipselect);
diff --git a/include/hw/devices.h b/include/hw/devices.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/devices.h
+++ b/include/hw/devices.h
@@ -XXX,XX +XXX,XX @@
 /* Devices that have nowhere better to go.  */
 
 #include "hw/hw.h"
-#include "ui/console.h"
 
 /* smc91c111.c */
 void smc91c111_init(NICInfo *, uint32_t, qemu_irq);
@@ -XXX,XX +XXX,XX @@ void smc91c111_init(NICInfo *, uint32_t, qemu_irq);
 /* lan9118.c */
 void lan9118_init(NICInfo *, uint32_t, qemu_irq);
 
-/* tsc210x.c */
-uWireSlave *tsc2102_init(qemu_irq pint);
-uWireSlave *tsc2301_init(qemu_irq penirq, qemu_irq kbirq, qemu_irq dav);
-I2SCodec *tsc210x_codec(uWireSlave *chip);
-uint32_t tsc210x_txrx(void *opaque, uint32_t value, int len);
-void tsc210x_set_transform(uWireSlave *chip,
-                MouseTransformInfo *info);
-void tsc210x_key_event(uWireSlave *chip, int key, int down);
-
-/* tsc2005.c */
-void *tsc2005_init(qemu_irq pintdav);
-uint32_t tsc2005_txrx(void *opaque, uint32_t value, int len);
-void tsc2005_set_transform(void *opaque, MouseTransformInfo *info);
-
 #endif
diff --git a/include/hw/input/tsc2xxx.h b/include/hw/input/tsc2xxx.h
new file mode 100644
index XXXXXXX..XXXXXXX
--- /dev/null
+++ b/include/hw/input/tsc2xxx.h
@@ -XXX,XX +XXX,XX @@
+/*
+ * TI touchscreen controller
+ *
+ * Copyright (c) 2006 Andrzej Zaborowski
+ * Copyright (C) 2008 Nokia Corporation
+ *
+ * This work is licensed under the terms of the GNU GPL, version 2 or later.
+ * See the COPYING file in the top-level directory.
+ */
+
+#ifndef HW_INPUT_TSC2XXX_H
+#define HW_INPUT_TSC2XXX_H
+
+#include "hw/irq.h"
+#include "ui/console.h"
+
+typedef struct uWireSlave {
+    uint16_t (*receive)(void *opaque);
+    void (*send)(void *opaque, uint16_t data);
+    void *opaque;
+} uWireSlave;
+
+/* tsc210x.c */
+uWireSlave *tsc2102_init(qemu_irq pint);
+uWireSlave *tsc2301_init(qemu_irq penirq, qemu_irq kbirq, qemu_irq dav);
+I2SCodec *tsc210x_codec(uWireSlave *chip);
+uint32_t tsc210x_txrx(void *opaque, uint32_t value, int len);
+void tsc210x_set_transform(uWireSlave *chip, MouseTransformInfo *info);
+void tsc210x_key_event(uWireSlave *chip, int key, int down);
+
+/* tsc2005.c */
+void *tsc2005_init(qemu_irq pintdav);
+uint32_t tsc2005_txrx(void *opaque, uint32_t value, int len);
+void tsc2005_set_transform(void *opaque, MouseTransformInfo *info);
+
+#endif
diff --git a/include/qemu/typedefs.h b/include/qemu/typedefs.h
index XXXXXXX..XXXXXXX 100644
--- a/include/qemu/typedefs.h
+++ b/include/qemu/typedefs.h
@@ -XXX,XX +XXX,XX @@ typedef struct RAMBlock RAMBlock;
 typedef struct Range Range;
 typedef struct SHPCDevice SHPCDevice;
 typedef struct SSIBus SSIBus;
-typedef struct uWireSlave uWireSlave;
 typedef struct VirtIODevice VirtIODevice;
 typedef struct Visitor Visitor;
 typedef void SaveStateHandler(QEMUFile *f, void *opaque);
diff --git a/hw/arm/nseries.c b/hw/arm/nseries.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/nseries.c
+++ b/hw/arm/nseries.c
@@ -XXX,XX +XXX,XX @@
 #include "ui/console.h"
 #include "hw/boards.h"
 #include "hw/i2c/i2c.h"
-#include "hw/devices.h"
 #include "hw/display/blizzard.h"
+#include "hw/input/tsc2xxx.h"
 #include "hw/misc/cbus.h"
 #include "hw/misc/tmp105.h"
 #include "hw/block/flash.h"
diff --git a/hw/arm/palm.c b/hw/arm/palm.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/palm.c
+++ b/hw/arm/palm.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/arm/omap.h"
 #include "hw/boards.h"
 #include "hw/arm/arm.h"
-#include "hw/devices.h"
+#include "hw/input/tsc2xxx.h"
 #include "hw/loader.h"
 #include "exec/address-spaces.h"
 #include "cpu.h"
diff --git a/hw/input/tsc2005.c b/hw/input/tsc2005.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/input/tsc2005.c
+++ b/hw/input/tsc2005.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/hw.h"
 #include "qemu/timer.h"
 #include "ui/console.h"
-#include "hw/devices.h"
+#include "hw/input/tsc2xxx.h"
 #include "trace.h"
 
 #define TSC_CUT_RESOLUTION(value, p)	((value) >> (16 - (p ? 12 : 10)))
diff --git a/hw/input/tsc210x.c b/hw/input/tsc210x.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/input/tsc210x.c
+++ b/hw/input/tsc210x.c
@@ -XXX,XX +XXX,XX @@
 #include "audio/audio.h"
 #include "qemu/timer.h"
 #include "ui/console.h"
-#include "hw/arm/omap.h"	/* For I2SCodec and uWireSlave */
-#include "hw/devices.h"
+#include "hw/arm/omap.h"            /* For I2SCodec */
+#include "hw/input/tsc2xxx.h"
 
 #define TSC_DATA_REGISTERS_PAGE		0x0
 #define TSC_CONTROL_REGISTERS_PAGE	0x1
diff --git a/MAINTAINERS b/MAINTAINERS
index XXXXXXX..XXXXXXX 100644
--- a/MAINTAINERS
+++ b/MAINTAINERS
@@ -XXX,XX +XXX,XX @@ F: hw/input/tsc2005.c
 F: hw/misc/cbus.c
 F: hw/timer/twl92230.c
 F: include/hw/display/blizzard.h
+F: include/hw/input/tsc2xxx.h
 F: include/hw/misc/cbus.h
 
 Palm
@@ -XXX,XX +XXX,XX @@ L: qemu-arm@nongnu.org
 S: Odd Fixes
 F: hw/arm/palm.c
 F: hw/input/tsc210x.c
+F: include/hw/input/tsc2xxx.h
 
 Raspberry Pi
 M: Peter Maydell <peter.maydell@linaro.org>
-- 
2.20.1

From: Philippe Mathieu-Daudé <philmd@redhat.com>

Reviewed-by: Markus Armbruster <armbru@redhat.com>
Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Message-id: 20190412165416.7977-10-philmd@redhat.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/devices.h     |  3 ---
 include/hw/net/lan9118.h | 19 +++++++++++++++++++
 hw/arm/kzm.c             |  2 +-
 hw/arm/mps2.c            |  2 +-
 hw/arm/realview.c        |  1 +
 hw/arm/vexpress.c        |  2 +-
 hw/net/lan9118.c         |  2 +-
 7 files changed, 24 insertions(+), 7 deletions(-)
 create mode 100644 include/hw/net/lan9118.h

diff --git a/include/hw/devices.h b/include/hw/devices.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/devices.h
+++ b/include/hw/devices.h
@@ -XXX,XX +XXX,XX @@
 /* smc91c111.c */
 void smc91c111_init(NICInfo *, uint32_t, qemu_irq);
 
-/* lan9118.c */
-void lan9118_init(NICInfo *, uint32_t, qemu_irq);
-
 #endif
diff --git a/include/hw/net/lan9118.h b/include/hw/net/lan9118.h
new file mode 100644
index XXXXXXX..XXXXXXX
--- /dev/null
+++ b/include/hw/net/lan9118.h
@@ -XXX,XX +XXX,XX @@
+/*
+ * SMSC LAN9118 Ethernet interface emulation
+ *
+ * Copyright (c) 2009 CodeSourcery, LLC.
+ * Written by Paul Brook
+ *
+ * This work is licensed under the terms of the GNU GPL, version 2 or later.
+ * See the COPYING file in the top-level directory.
+ */
+
+#ifndef HW_NET_LAN9118_H
+#define HW_NET_LAN9118_H
+
+#include "hw/irq.h"
+#include "net/net.h"
+
+void lan9118_init(NICInfo *, uint32_t, qemu_irq);
+
+#endif
diff --git a/hw/arm/kzm.c b/hw/arm/kzm.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/kzm.c
+++ b/hw/arm/kzm.c
@@ -XXX,XX +XXX,XX @@
 #include "qemu/error-report.h"
 #include "exec/address-spaces.h"
 #include "net/net.h"
-#include "hw/devices.h"
+#include "hw/net/lan9118.h"
 #include "hw/char/serial.h"
 #include "sysemu/qtest.h"
 
diff --git a/hw/arm/mps2.c b/hw/arm/mps2.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/mps2.c
+++ b/hw/arm/mps2.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/timer/cmsdk-apb-timer.h"
 #include "hw/timer/cmsdk-apb-dualtimer.h"
 #include "hw/misc/mps2-scc.h"
-#include "hw/devices.h"
+#include "hw/net/lan9118.h"
 #include "net/net.h"
 
 typedef enum MPS2FPGAType {
diff --git a/hw/arm/realview.c b/hw/arm/realview.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/realview.c
+++ b/hw/arm/realview.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/arm/arm.h"
 #include "hw/arm/primecell.h"
 #include "hw/devices.h"
+#include "hw/net/lan9118.h"
 #include "hw/pci/pci.h"
 #include "net/net.h"
 #include "sysemu/sysemu.h"
diff --git a/hw/arm/vexpress.c b/hw/arm/vexpress.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/vexpress.c
+++ b/hw/arm/vexpress.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/sysbus.h"
 #include "hw/arm/arm.h"
 #include "hw/arm/primecell.h"
-#include "hw/devices.h"
+#include "hw/net/lan9118.h"
 #include "hw/i2c/i2c.h"
 #include "net/net.h"
 #include "sysemu/sysemu.h"
diff --git a/hw/net/lan9118.c b/hw/net/lan9118.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/net/lan9118.c
+++ b/hw/net/lan9118.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/sysbus.h"
 #include "net/net.h"
 #include "net/eth.h"
-#include "hw/devices.h"
+#include "hw/net/lan9118.h"
 #include "sysemu/sysemu.h"
 #include "hw/ptimer.h"
 #include "qemu/log.h"
-- 
2.20.1

From: Philippe Mathieu-Daudé <philmd@redhat.com>

Reviewed-by: Markus Armbruster <armbru@redhat.com>
Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Message-id: 20190412165416.7977-12-philmd@redhat.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/net/lan9118.h | 2 ++
 hw/arm/exynos4_boards.c  | 3 ++-
 hw/arm/mps2-tz.c         | 3 ++-
 hw/net/lan9118.c         | 1 -
 4 files changed, 6 insertions(+), 3 deletions(-)

diff --git a/include/hw/net/lan9118.h b/include/hw/net/lan9118.h
index XXXXXXX..XXXXXXX 100644
--- a/include/hw/net/lan9118.h
+++ b/include/hw/net/lan9118.h
@@ -XXX,XX +XXX,XX @@
 #include "hw/irq.h"
 #include "net/net.h"
 
+#define TYPE_LAN9118 "lan9118"
+
 void lan9118_init(NICInfo *, uint32_t, qemu_irq);
 
 #endif
diff --git a/hw/arm/exynos4_boards.c b/hw/arm/exynos4_boards.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/exynos4_boards.c
+++ b/hw/arm/exynos4_boards.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/arm/arm.h"
 #include "exec/address-spaces.h"
 #include "hw/arm/exynos4210.h"
+#include "hw/net/lan9118.h"
 #include "hw/boards.h"
 
 #undef DEBUG
@@ -XXX,XX +XXX,XX @@ static void lan9215_init(uint32_t base, qemu_irq irq)
     /* This should be a 9215 but the 9118 is close enough */
     if (nd_table[0].used) {
         qemu_check_nic_model(&nd_table[0], "lan9118");
-        dev = qdev_create(NULL, "lan9118");
+        dev = qdev_create(NULL, TYPE_LAN9118);
         qdev_set_nic_properties(dev, &nd_table[0]);
         qdev_prop_set_uint32(dev, "mode_16bit", 1);
         qdev_init_nofail(dev);
diff --git a/hw/arm/mps2-tz.c b/hw/arm/mps2-tz.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/mps2-tz.c
+++ b/hw/arm/mps2-tz.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/arm/armsse.h"
 #include "hw/dma/pl080.h"
 #include "hw/ssi/pl022.h"
+#include "hw/net/lan9118.h"
 #include "net/net.h"
 #include "hw/core/split-irq.h"
 
@@ -XXX,XX +XXX,XX @@ static MemoryRegion *make_eth_dev(MPS2TZMachineState *mms, void *opaque,
      * except that it doesn't support the checksum-offload feature.
      */
     qemu_check_nic_model(nd, "lan9118");
-    mms->lan9118 = qdev_create(NULL, "lan9118");
+    mms->lan9118 = qdev_create(NULL, TYPE_LAN9118);
     qdev_set_nic_properties(mms->lan9118, nd);
     qdev_init_nofail(mms->lan9118);
 
diff --git a/hw/net/lan9118.c b/hw/net/lan9118.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/net/lan9118.c
+++ b/hw/net/lan9118.c
@@ -XXX,XX +XXX,XX @@ static const VMStateDescription vmstate_lan9118_packet = {
     }
 };
 
-#define TYPE_LAN9118 "lan9118"
 #define LAN9118(obj) OBJECT_CHECK(lan9118_state, (obj), TYPE_LAN9118)
 
 typedef struct {
-- 
2.20.1

From: Philippe Mathieu-Daudé <philmd@redhat.com>

This commit finally deletes "hw/devices.h".

Reviewed-by: Markus Armbruster <armbru@redhat.com>
Signed-off-by: Philippe Mathieu-Daudé <philmd@redhat.com>
Message-id: 20190412165416.7977-13-philmd@redhat.com
Signed-off-by: Peter Maydell <peter.maydell@linaro.org>
---
 include/hw/devices.h       | 11 -----------
 include/hw/net/smc91c111.h | 19 +++++++++++++++++++
 hw/arm/gumstix.c           |  2 +-
 hw/arm/integratorcp.c      |  2 +-
 hw/arm/mainstone.c         |  2 +-
 hw/arm/realview.c          |  2 +-
 hw/arm/versatilepb.c       |  2 +-
 hw/net/smc91c111.c         |  2 +-
 8 files changed, 25 insertions(+), 17 deletions(-)
 delete mode 100644 include/hw/devices.h
 create mode 100644 include/hw/net/smc91c111.h

diff --git a/include/hw/devices.h b/include/hw/devices.h
deleted file mode 100644
index XXXXXXX..XXXXXXX
--- a/include/hw/devices.h
+++ /dev/null
@@ -XXX,XX +XXX,XX @@
-#ifndef QEMU_DEVICES_H
-#define QEMU_DEVICES_H
-
-/* Devices that have nowhere better to go.  */
-
-#include "hw/hw.h"
-
-/* smc91c111.c */
-void smc91c111_init(NICInfo *, uint32_t, qemu_irq);
-
-#endif
diff --git a/include/hw/net/smc91c111.h b/include/hw/net/smc91c111.h
new file mode 100644
index XXXXXXX..XXXXXXX
--- /dev/null
+++ b/include/hw/net/smc91c111.h
@@ -XXX,XX +XXX,XX @@
+/*
+ * SMSC 91C111 Ethernet interface emulation
+ *
+ * Copyright (c) 2005 CodeSourcery, LLC.
+ * Written by Paul Brook
+ *
+ * This work is licensed under the terms of the GNU GPL, version 2 or later.
+ * See the COPYING file in the top-level directory.
+ */
+
+#ifndef HW_NET_SMC91C111_H
+#define HW_NET_SMC91C111_H
+
+#include "hw/irq.h"
+#include "net/net.h"
+
+void smc91c111_init(NICInfo *, uint32_t, qemu_irq);
+
+#endif
diff --git a/hw/arm/gumstix.c b/hw/arm/gumstix.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/gumstix.c
+++ b/hw/arm/gumstix.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/arm/pxa.h"
 #include "net/net.h"
 #include "hw/block/flash.h"
-#include "hw/devices.h"
+#include "hw/net/smc91c111.h"
 #include "hw/boards.h"
 #include "exec/address-spaces.h"
 #include "sysemu/qtest.h"
diff --git a/hw/arm/integratorcp.c b/hw/arm/integratorcp.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/integratorcp.c
+++ b/hw/arm/integratorcp.c
@@ -XXX,XX +XXX,XX @@
 #include "qemu-common.h"
 #include "cpu.h"
 #include "hw/sysbus.h"
-#include "hw/devices.h"
 #include "hw/boards.h"
 #include "hw/arm/arm.h"
 #include "hw/misc/arm_integrator_debug.h"
+#include "hw/net/smc91c111.h"
 #include "net/net.h"
 #include "exec/address-spaces.h"
 #include "sysemu/sysemu.h"
diff --git a/hw/arm/mainstone.c b/hw/arm/mainstone.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/mainstone.c
+++ b/hw/arm/mainstone.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/arm/pxa.h"
 #include "hw/arm/arm.h"
 #include "net/net.h"
-#include "hw/devices.h"
+#include "hw/net/smc91c111.h"
 #include "hw/boards.h"
 #include "hw/block/flash.h"
 #include "hw/sysbus.h"
diff --git a/hw/arm/realview.c b/hw/arm/realview.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/realview.c
+++ b/hw/arm/realview.c
@@ -XXX,XX +XXX,XX @@
 #include "hw/sysbus.h"
 #include "hw/arm/arm.h"
 #include "hw/arm/primecell.h"
-#include "hw/devices.h"
 #include "hw/net/lan9118.h"
+#include "hw/net/smc91c111.h"
 #include "hw/pci/pci.h"
 #include "net/net.h"
 #include "sysemu/sysemu.h"
diff --git a/hw/arm/versatilepb.c b/hw/arm/versatilepb.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/arm/versatilepb.c
+++ b/hw/arm/versatilepb.c
@@ -XXX,XX +XXX,XX @@
 #include "cpu.h"
 #include "hw/sysbus.h"
 #include "hw/arm/arm.h"
-#include "hw/devices.h"
+#include "hw/net/smc91c111.h"
 #include "net/net.h"
 #include "sysemu/sysemu.h"
 #include "hw/pci/pci.h"
diff --git a/hw/net/smc91c111.c b/hw/net/smc91c111.c
index XXXXXXX..XXXXXXX 100644
--- a/hw/net/smc91c111.c
+++ b/hw/net/smc91c111.c
@@ -XXX,XX +XXX,XX @@
 #include "qemu/osdep.h"
 #include "hw/sysbus.h"
 #include "net/net.h"
-#include "hw/devices.h"
+#include "hw/net/smc91c111.h"
 #include "qemu/log.h"
 /* For crc32 */
 #include <zlib.h>
-- 
2.20.1