From nobody Wed Feb 11 05:29:57 2026
Delivered-To: importer@patchew.org
Received-SPF: pass (zoho.com: domain of gnu.org designates 208.118.235.17 as
 permitted sender) client-ip=208.118.235.17;
 envelope-from=qemu-devel-bounces+importer=patchew.org@nongnu.org;
 helo=lists.gnu.org;
Authentication-Results: mx.zohomail.com;
	dkim=fail;
	spf=pass (zoho.com: domain of gnu.org designates 208.118.235.17 as permitted
 sender)  smtp.mailfrom=qemu-devel-bounces+importer=patchew.org@nongnu.org
Return-Path: <qemu-devel-bounces+importer=patchew.org@nongnu.org>
Received: from lists.gnu.org (lists.gnu.org [208.118.235.17]) by
 mx.zohomail.com
	with SMTPS id 1507142748239953.063255897527;
 Wed, 4 Oct 2017 11:45:48 -0700 (PDT)
Received: from localhost ([::1]:36440 helo=lists.gnu.org)
	by lists.gnu.org with esmtp (Exim 4.71)
	(envelope-from <qemu-devel-bounces+importer=patchew.org@nongnu.org>)
	id 1dzofq-0001AH-Hn
	for importer@patchew.org; Wed, 04 Oct 2017 14:45:38 -0400
Received: from eggs.gnu.org ([2001:4830:134:3::10]:38324)
	by lists.gnu.org with esmtp (Exim 4.71)
	(envelope-from <richard.henderson@linaro.org>) id 1dzoe1-0008JB-SX
	for qemu-devel@nongnu.org; Wed, 04 Oct 2017 14:43:47 -0400
Received: from Debian-exim by eggs.gnu.org with spam-scanned (Exim 4.71)
	(envelope-from <richard.henderson@linaro.org>) id 1dzoe0-0002pg-EC
	for qemu-devel@nongnu.org; Wed, 04 Oct 2017 14:43:45 -0400
Received: from mail-qt0-x22d.google.com ([2607:f8b0:400d:c0d::22d]:48045)
	by eggs.gnu.org with esmtps (TLS1.0:RSA_AES_128_CBC_SHA1:16)
	(Exim 4.71) (envelope-from <richard.henderson@linaro.org>)
	id 1dzoe0-0002p6-A0
	for qemu-devel@nongnu.org; Wed, 04 Oct 2017 14:43:44 -0400
Received: by mail-qt0-x22d.google.com with SMTP id z50so16036173qtj.4
	for <qemu-devel@nongnu.org>; Wed, 04 Oct 2017 11:43:44 -0700 (PDT)
Received: from bigtime.twiddle.net.com ([2606:a000:7a4a:b100::1b])
	by smtp.gmail.com with ESMTPSA id
	o64sm3020464ywe.12.2017.10.04.11.43.42
	(version=TLS1_2 cipher=ECDHE-RSA-CHACHA20-POLY1305 bits=256/256);
	Wed, 04 Oct 2017 11:43:42 -0700 (PDT)
DKIM-Signature: v=1; a=rsa-sha256; c=relaxed/relaxed; d=linaro.org; s=google;
	h=from:to:cc:subject:date:message-id:in-reply-to:references;
	bh=cQOUBaL8w3dJdOUvtpUs7iuCm57GpBDP9Dt+8anjwCE=;
	b=IUop+dfeSbmxIcFbsvStsgnEs1S5I4m4KPWVECEAh3/URWUKeD+BdY+CTGnovVMlm0
	P/KJBEctuB1QP8Exay+cF/tub1+gHimplUWYCo5p73uWWzIgdwB/Dhg0VAMCSETnZO17
	F5/gNHB2K2x+Uy+hrjtWs5d7kIEOpLz3t3acA=
X-Google-DKIM-Signature: v=1; a=rsa-sha256; c=relaxed/relaxed;
	d=1e100.net; s=20161025;
	h=x-gm-message-state:from:to:cc:subject:date:message-id:in-reply-to
	:references;
	bh=cQOUBaL8w3dJdOUvtpUs7iuCm57GpBDP9Dt+8anjwCE=;
	b=NvKtbrxiJPNz4Uusmz5mNKi0TKcAfiHubke5ykg9A+FNUi+jQmfTPyV+9Uz8V3l8UE
	i9a6Kfi4uN38N0L9qz8oK9Obyli1Ypg8XpogpkmEdGgSFgmOyndJw+G1af60alFz4vM/
	br5LFSrsRKJgww16W5ueqm1lgmYy4DQBryVq2DrBwkd4nVol7D+9yOsvjlW644zoqR68
	Y5oL/Va3AmJDIP94CoEc6UWk6hW9wosQoN40MekspApS1L3WWUSYjVbiOcinEfr8Q9va
	PBL9Y5fNae6+yojAGHF/DkzOvlp6YI34ayXd5Jbxxu9mANk0sfnHRQdLhH66o9cwEewf
	3wVA==
X-Gm-Message-State: AMCzsaVvXczQyfuIJ3CAkIi9haNNbkW6/OVInSJwVsjZ47oMIgSmMTo5
	4vGdBM8w6Cr1P5AYCo5+3LXe43PK9xw=
X-Google-Smtp-Source: 
 AOwi7QCVBjvbIFVy6H3dNU4p6XLgIkeVcoiMvi3lbfjJcg7WzVri/8wdPfWgdcnU+txNHUy35JUdFg==
X-Received: by 10.37.163.71 with SMTP id d65mr4516952ybi.314.1507142623371;
	Wed, 04 Oct 2017 11:43:43 -0700 (PDT)
From: Richard Henderson <richard.henderson@linaro.org>
To: qemu-devel@nongnu.org
Date: Wed,  4 Oct 2017 14:43:23 -0400
Message-Id: <20171004184325.24157-11-richard.henderson@linaro.org>
X-Mailer: git-send-email 2.13.6
In-Reply-To: <20171004184325.24157-1-richard.henderson@linaro.org>
References: <20171004184325.24157-1-richard.henderson@linaro.org>
X-detected-operating-system: by eggs.gnu.org: Genre and OS details not
	recognized.
X-Received-From: 2607:f8b0:400d:c0d::22d
Subject: [Qemu-devel] [PATCH v1 10/12] target/arm: Decode aa64 armv8.3 fcmla
X-BeenThere: qemu-devel@nongnu.org
X-Mailman-Version: 2.1.21
Precedence: list
List-Id: <qemu-devel.nongnu.org>
List-Unsubscribe: <https://lists.nongnu.org/mailman/options/qemu-devel>,
	<mailto:qemu-devel-request@nongnu.org?subject=unsubscribe>
List-Archive: <http://lists.nongnu.org/archive/html/qemu-devel/>
List-Post: <mailto:qemu-devel@nongnu.org>
List-Help: <mailto:qemu-devel-request@nongnu.org?subject=help>
List-Subscribe: <https://lists.nongnu.org/mailman/listinfo/qemu-devel>,
	<mailto:qemu-devel-request@nongnu.org?subject=subscribe>
Cc: qemu-arm@nongnu.org
Errors-To: qemu-devel-bounces+importer=patchew.org@nongnu.org
Sender: "Qemu-devel" <qemu-devel-bounces+importer=patchew.org@nongnu.org>
X-ZohoMail-DKIM: fail (Header signature does not verify)
X-ZohoMail: RDKM_2  RSF_0  Z_629925259 SPT_0
Content-Transfer-Encoding: quoted-printable
MIME-Version: 1.0
Content-Type: text/plain; charset="utf-8"

Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
---
 target/arm/helper.h         |   8 +++
 target/arm/advsimd_helper.c |  86 ++++++++++++++++++++++++++++++++
 target/arm/translate-a64.c  | 119 ++++++++++++++++++++++++++++++----------=
----
 3 files changed, 176 insertions(+), 37 deletions(-)

diff --git a/target/arm/helper.h b/target/arm/helper.h
index 350e2fa0e1..de3cc43a7a 100644
--- a/target/arm/helper.h
+++ b/target/arm/helper.h
@@ -556,6 +556,14 @@ DEF_HELPER_FLAGS_5(gvec_fcadds, TCG_CALL_NO_RWG,
 DEF_HELPER_FLAGS_5(gvec_fcaddd, TCG_CALL_NO_RWG,
                    void, ptr, ptr, ptr, ptr, i32)
=20
+DEF_HELPER_FLAGS_5(gvec_fcmlas, TCG_CALL_NO_RWG,
+                   void, ptr, ptr, ptr, ptr, i32)
+DEF_HELPER_FLAGS_5(gvec_fcmlas_idx, TCG_CALL_NO_RWG,
+                   void, ptr, ptr, ptr, ptr, i32)
+DEF_HELPER_FLAGS_5(gvec_fcmlad, TCG_CALL_NO_RWG,
+                   void, ptr, ptr, ptr, ptr, i32)
+
+
 #ifdef TARGET_AARCH64
 #include "helper-a64.h"
 #endif
diff --git a/target/arm/advsimd_helper.c b/target/arm/advsimd_helper.c
index fe2e0cbcef..acb452df1b 100644
--- a/target/arm/advsimd_helper.c
+++ b/target/arm/advsimd_helper.c
@@ -243,3 +243,89 @@ void HELPER(gvec_fcaddd)(void *vd, void *vn, void *vm,
     }
     clear_tail(d, opr_sz, simd_maxsz(desc));
 }
+
+void HELPER(gvec_fcmlas)(void *vd, void *vn, void *vm,
+                         void *vfpst, uint32_t desc)
+{
+    uintptr_t opr_sz =3D simd_oprsz(desc);
+    float32 *d =3D vd;
+    float32 *n =3D vn;
+    float32 *m =3D vm;
+    float_status *fpst =3D vfpst;
+    intptr_t flip =3D extract32(desc, SIMD_DATA_SHIFT, 1);
+    uint32_t neg_imag =3D extract32(desc, SIMD_DATA_SHIFT + 1, 1);
+    uint32_t neg_real =3D flip ^ neg_imag;
+    uintptr_t i;
+
+    neg_real <<=3D 31;
+    neg_imag <<=3D 31;
+
+    for (i =3D 0; i < opr_sz / 4; i +=3D 2) {
+        float32 e0 =3D n[H4(i + flip)];
+        float32 e1 =3D m[H4(i + flip)] ^ neg_real;
+        float32 e2 =3D e0;
+        float32 e3 =3D m[H4(i + 1 - flip)] ^ neg_imag;
+
+        d[H4(i)] =3D float32_muladd(e0, e1, d[H4(i)], 0, fpst);
+        d[H4(i + 1)] =3D float32_muladd(e2, e3, d[H4(i + 1)], 0, fpst);
+    }
+    clear_tail(d, opr_sz, simd_maxsz(desc));
+}
+
+void HELPER(gvec_fcmlas_idx)(void *vd, void *vn, void *vm,
+                             void *vfpst, uint32_t desc)
+{
+    uintptr_t opr_sz =3D simd_oprsz(desc);
+    float32 *d =3D vd;
+    float32 *n =3D vn;
+    float32 *m =3D vm;
+    float_status *fpst =3D vfpst;
+    intptr_t flip =3D extract32(desc, SIMD_DATA_SHIFT, 1);
+    uint32_t neg_imag =3D extract32(desc, SIMD_DATA_SHIFT + 1, 1);
+    uint32_t neg_real =3D flip ^ neg_imag;
+    uintptr_t i;
+    float32 e1 =3D m[H4(flip)];
+    float32 e3 =3D m[H4(1 - flip)];
+
+    neg_real <<=3D 31;
+    neg_imag <<=3D 31;
+    e1 ^=3D neg_real;
+    e3 ^=3D neg_imag;
+
+    for (i =3D 0; i < opr_sz / 4; i +=3D 2) {
+        float32 e0 =3D n[H4(i + flip)];
+        float32 e2 =3D e0;
+
+        d[H4(i)] =3D float32_muladd(e0, e1, d[H4(i)], 0, fpst);
+        d[H4(i + 1)] =3D float32_muladd(e2, e3, d[H4(i + 1)], 0, fpst);
+    }
+    clear_tail(d, opr_sz, simd_maxsz(desc));
+}
+
+void HELPER(gvec_fcmlad)(void *vd, void *vn, void *vm,
+                         void *vfpst, uint32_t desc)
+{
+    uintptr_t opr_sz =3D simd_oprsz(desc);
+    float64 *d =3D vd;
+    float64 *n =3D vn;
+    float64 *m =3D vm;
+    float_status *fpst =3D vfpst;
+    intptr_t flip =3D extract32(desc, SIMD_DATA_SHIFT, 1);
+    uint64_t neg_imag =3D extract32(desc, SIMD_DATA_SHIFT + 1, 1);
+    uint64_t neg_real =3D flip ^ neg_imag;
+    uintptr_t i;
+
+    neg_real <<=3D 63;
+    neg_imag <<=3D 63;
+
+    for (i =3D 0; i < opr_sz / 8; i +=3D 2) {
+        float64 e0 =3D n[i + flip];
+        float64 e1 =3D m[i + flip] ^ neg_real;
+        float64 e2 =3D e0;
+        float64 e3 =3D m[i + 1 - flip] ^ neg_imag;
+
+        d[i] =3D float64_muladd(e0, e1, d[i], 0, fpst);
+        d[i + 1] =3D float64_muladd(e2, e3, d[i + 1], 0, fpst);
+    }
+    clear_tail(d, opr_sz, simd_maxsz(desc));
+}
diff --git a/target/arm/translate-a64.c b/target/arm/translate-a64.c
index f13a945c43..b572122227 100644
--- a/target/arm/translate-a64.c
+++ b/target/arm/translate-a64.c
@@ -9907,6 +9907,10 @@ static void disas_simd_three_reg_same_extra(DisasCon=
text *s, uint32_t insn)
         }
         feature =3D ARM_FEATURE_V8_1_SIMD;
         break;
+    case 0x8: /* FCMLA, #0 */
+    case 0x9: /* FCMLA, #90 */
+    case 0xa: /* FCMLA, #180 */
+    case 0xb: /* FCMLA, #270 */
     case 0xc: /* FCADD, #90 */
     case 0xe: /* FCADD, #270 */
         if (size !=3D 2 && (size !=3D 3 || !is_q)) { /* FIXME: fp16 suppor=
t */
@@ -9961,6 +9965,24 @@ static void disas_simd_three_reg_same_extra(DisasCon=
text *s, uint32_t insn)
                            0, fn_gvec_ptr);
         break;
=20
+    case 0x8: /* FCMLA, #0 */
+    case 0x9: /* FCMLA, #90 */
+    case 0xa: /* FCMLA, #180 */
+    case 0xb: /* FCMLA, #270 */
+        switch (size) {
+        case 2:
+            fn_gvec_ptr =3D gen_helper_gvec_fcmlas;
+            break;
+        case 3:
+            fn_gvec_ptr =3D gen_helper_gvec_fcmlad;
+            break;
+        default:
+            g_assert_not_reached();
+        }
+        data =3D extract32(opcode, 0, 2);
+        goto do_fpst;
+        break;
+
     case 0xc: /* FCADD, #90 */
     case 0xe: /* FCADD, #270 */
         switch (size) {
@@ -9974,6 +9996,7 @@ static void disas_simd_three_reg_same_extra(DisasCont=
ext *s, uint32_t insn)
             g_assert_not_reached();
         }
         data =3D extract32(opcode, 1, 1);
+    do_fpst:
         fpst =3D get_fpstatus_ptr();
         tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, rd),
                            vec_full_reg_offset(s, rn),
@@ -10753,76 +10776,75 @@ static void disas_simd_indexed(DisasContext *s, u=
int32_t insn)
     int rn =3D extract32(insn, 5, 5);
     int rd =3D extract32(insn, 0, 5);
     bool is_long =3D false;
-    bool is_fp =3D false;
+    int is_fp =3D 0;
     int index;
     TCGv_ptr fpst;
=20
-    switch (opcode) {
-    case 0x0: /* MLA */
-    case 0x4: /* MLS */
-        if (!u || is_scalar) {
+    switch (16 * u + opcode) {
+    case 0x00: /* MLA */
+    case 0x04: /* MLS */
+    case 0x08: /* MUL */
+        if (is_scalar) {
             unallocated_encoding(s);
             return;
         }
         break;
-    case 0x2: /* SMLAL, SMLAL2, UMLAL, UMLAL2 */
-    case 0x6: /* SMLSL, SMLSL2, UMLSL, UMLSL2 */
-    case 0xa: /* SMULL, SMULL2, UMULL, UMULL2 */
+    case 0x02: /* SMLAL, SMLAL2 */
+    case 0x12: /* UMLAL, UMLAL2 */
+    case 0x06: /* SMLSL, SMLSL2 */
+    case 0x16: /* UMLSL, UMLSL2 */
+    case 0x0a: /* SMULL, SMULL2 */
+    case 0x1a: /* UMULL, UMULL2 */
         if (is_scalar) {
             unallocated_encoding(s);
             return;
         }
         is_long =3D true;
         break;
-    case 0x3: /* SQDMLAL, SQDMLAL2 */
-    case 0x7: /* SQDMLSL, SQDMLSL2 */
-    case 0xb: /* SQDMULL, SQDMULL2 */
+    case 0x03: /* SQDMLAL, SQDMLAL2 */
+    case 0x07: /* SQDMLSL, SQDMLSL2 */
+    case 0x0b: /* SQDMULL, SQDMULL2 */
         is_long =3D true;
-        /* fall through */
-    case 0xc: /* SQDMULH */
-        if (u) {
-            unallocated_encoding(s);
-            return;
-        }
         break;
-    case 0xd: /* SQRDMULH / SQRDMLAH */
-        if (u && !arm_dc_feature(s, ARM_FEATURE_V8_1_SIMD)) {
-            unallocated_encoding(s);
-            return;
-        }
+    case 0x0c: /* SQDMULH */
+    case 0x0d: /* SQRDMULH */
         break;
-    case 0xf: /* SQRDMLSH */
-        if (!u || !arm_dc_feature(s, ARM_FEATURE_V8_1_SIMD)) {
+    case 0x1d: /* SQRDMLAH */
+    case 0x1f: /* SQRDMLSH */
+        if (!arm_dc_feature(s, ARM_FEATURE_V8_1_SIMD)) {
             unallocated_encoding(s);
             return;
         }
         break;
-    case 0x8: /* MUL */
-        if (u || is_scalar) {
+    case 0x11: /* FCMLA #0 */
+    case 0x13: /* FCMLA #90 */
+    case 0x15: /* FCMLA #180 */
+    case 0x17: /* FCMLA #270 */
+        if (size !=3D 2 /* FIXME fp16 */
+            || (l || !is_q)
+            || !arm_dc_feature(s, ARM_FEATURE_V8_FCMA)) {
             unallocated_encoding(s);
             return;
         }
+        is_fp =3D 2;
         break;
-    case 0x1: /* FMLA */
-    case 0x5: /* FMLS */
-        if (u) {
-            unallocated_encoding(s);
-            return;
-        }
-        /* fall through */
-    case 0x9: /* FMUL, FMULX */
+    case 0x01: /* FMLA */
+    case 0x05: /* FMLS */
+    case 0x09: /* FMUL */
+    case 0x19: /* FMULX */
         if (!extract32(size, 1, 1)) {
             unallocated_encoding(s);
             return;
         }
-        is_fp =3D true;
+        is_fp =3D 1;
         break;
     default:
         unallocated_encoding(s);
         return;
     }
=20
-    if (is_fp) {
+    switch (is_fp) {
+    case 1: /* normal fp */
         /* low bit of size indicates single/double */
         size =3D extract32(size, 0, 1) ? 3 : 2;
         if (size =3D=3D 2) {
@@ -10835,7 +10857,15 @@ static void disas_simd_indexed(DisasContext *s, ui=
nt32_t insn)
             index =3D h;
         }
         rm |=3D (m << 4);
-    } else {
+        break;
+
+    case 2: /* complex fp */
+        /* FIXME fp16 */
+        index =3D h;
+        rm |=3D (m << 4);
+        break;
+
+    default: /* integer */
         switch (size) {
         case 1:
             index =3D h << 2 | l << 1 | m;
@@ -10860,6 +10890,21 @@ static void disas_simd_indexed(DisasContext *s, ui=
nt32_t insn)
         TCGV_UNUSED_PTR(fpst);
     }
=20
+    switch (16 * u + opcode) {
+    case 0x11: /* FCMLA #0 */
+    case 0x13: /* FCMLA #90 */
+    case 0x15: /* FCMLA #180 */
+    case 0x17: /* FCMLA #270 */
+        tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, rd),
+                           vec_full_reg_offset(s, rn),
+                           vec_reg_offset(s, rm, index, MO_64), fpst,
+                           is_q ? 16 : 8, vec_full_reg_size(s),
+                           extract32(insn, 13, 2), /* rot */
+                           gen_helper_gvec_fcmlas_idx);
+        tcg_temp_free_ptr(fpst);
+        return;
+    }
+
     if (size =3D=3D 3) {
         TCGv_i64 tcg_idx =3D tcg_temp_new_i64();
         int pass;
--=20
2.13.6