This is the mail archive of the
binutils@sourceware.org
mailing list for the binutils project.
RE: [PATCH 4/4] Arm64: correct address index operands for LD1RO{H,W,D}
- From: Tamar Christina <Tamar dot Christina at arm dot com>
- To: Jan Beulich <JBeulich at suse dot com>, "binutils at sourceware dot org" <binutils at sourceware dot org>
- Cc: Marcus Shawcroft <Marcus dot Shawcroft at arm dot com>, Mihail Ionescu <Mihail dot Ionescu at arm dot com>, Richard Earnshaw <Richard dot Earnshaw at arm dot com>, nd <nd at arm dot com>
- Date: Mon, 30 Dec 2019 12:26:14 +0000
- Subject: RE: [PATCH 4/4] Arm64: correct address index operands for LD1RO{H,W,D}
- Arc-authentication-results: i=1; mx.microsoft.com 1; spf=pass smtp.mailfrom=arm.com; dmarc=pass action=none header.from=arm.com; dkim=pass header.d=arm.com; arc=none
- Arc-message-signature: i=1; a=rsa-sha256; c=relaxed/relaxed; d=microsoft.com; s=arcselector9901; h=From:Date:Subject:Message-ID:Content-Type:MIME-Version:X-MS-Exchange-SenderADCheck; bh=8YNWT9N4PSYGFGcXZpKykyO1hzcE4nW0MxdmUWNtDYw=; b=ZXQukU9mB7pQXOIT3Ij1gXhHWIdKYx/SRIXIfMWBWOAHfDi98Rduhxj7zU+rSITafgOiuPrzlasFsFmsOEYrCF1DPPybZfm49yXy7S77BOeQmS8FwJ5OPaMF0zIcN1q2a9thkQj+/suirOTYR9JtRz7S/nuZWEyjHemmbISL5N7DcDhvvYSssJRpgOEnC4PiC/HD6sm0J5452yJfZJ3/a9rB1p1HegB4gyp1y/gtImy6GaGFVGC9g6RQIkXNgR+UXb5fsPHWL8slJCac8+iq3vjjd3fHJyPNfiNVkguePA3AcdAtaGWVGIQB9OLhEim8LxTZOf6VfkgLHttzR8DXpQ==
- Arc-seal: i=1; a=rsa-sha256; s=arcselector9901; d=microsoft.com; cv=none; b=C4Hk2tKU8ECRMBcDjn99oXLgEX124m/IXc1xhROJTFucHsoFHx5V+Zpu480cyhqUfoeNtRDQVabK2xh1MmVmNDuWXm3whlOgVleJ6R+MTJ+FFgticGFhvIa+OeTbPhnZQRrzT8pzlYX8zcex1YCu81z3q+M6QmolAHLJqnytZwxiEhM09747Wee8ftZqGqfn+Yn4BUPKYkGykb4ob17vduOnB5zA+veJwSvMVSBd8S6HTHKXCmDrTD2ysWMr5nFit/nbJ8OMndWBYVYH2Z3u36KsMG7WCR4XWf1MIKQHYwB6vMI281UH43A2UVnzdFwuJK8xbuEX+8UqzwBVM509Mg==
- Original-authentication-results: spf=none (sender IP is ) smtp.mailfrom=Tamar dot Christina at arm dot com;
- References: <37213fea-ae2e-0293-a042-9db2274cd061@suse.com> <ff24a120-8954-adf5-b1ac-62f040d5db4e@suse.com>
Hi Jan,
Thanks for fixing these. The changes look correct to me but I'm not a maintainer so can't approve.
Cheers,
Tamar
> -----Original Message-----
> From: binutils-owner@sourceware.org <binutils-owner@sourceware.org>
> On Behalf Of Jan Beulich
> Sent: Friday, December 27, 2019 10:40
> To: binutils@sourceware.org
> Cc: Marcus Shawcroft <Marcus.Shawcroft@arm.com>; Mihail Ionescu
> <Mihail.Ionescu@arm.com>; Richard Earnshaw
> <Richard.Earnshaw@arm.com>
> Subject: [PATCH 4/4] Arm64: correct address index operands for
> LD1RO{H,W,D}
>
> Just like their LD1RQ{H,W,D} counterparts, as per the specification the index
> registers get scaled by element size.
>
> gas/
> 2020-01-XX Jan Beulich <jbeulich@suse.com>
>
> * testsuite/gas/aarch64/f64mm.s: Scale index of LD1RO{H,W,D}.
> * testsuite/gas/aarch64/f64mm.d: Adjust expectations.
>
> opcodes/
> 2020-01-XX Jan Beulich <jbeulich@suse.com>
>
> * opcodes/aarch64-tbl.h (aarch64_opcode_table): Use
> SVE_ADDR_RX_LSL{1,2,3} for LD1RO{H,W,D}.
>
> --- a/gas/testsuite/gas/aarch64/f64mm.d
> +++ b/gas/testsuite/gas/aarch64/f64mm.d
> @@ -10,20 +10,20 @@ Disassembly of section \.text:
> *[0-9a-f]+: 64e0e400 fmmla z0\.d, z0\.d, z0\.d
> *[0-9a-f]+: a43b17f1 ld1rob {z17\.b}, p5/z, \[sp, x27\]
> *[0-9a-f]+: a42003e0 ld1rob {z0\.b}, p0/z, \[sp, x0\]
> - *[0-9a-f]+: a4bb17f1 ld1roh {z17\.h}, p5/z, \[sp, x27\]
> - *[0-9a-f]+: a4a003e0 ld1roh {z0\.h}, p0/z, \[sp, x0\]
> - *[0-9a-f]+: a53b17f1 ld1row {z17\.s}, p5/z, \[sp, x27\]
> - *[0-9a-f]+: a52003e0 ld1row {z0\.s}, p0/z, \[sp, x0\]
> - *[0-9a-f]+: a5bb17f1 ld1rod {z17\.d}, p5/z, \[sp, x27\]
> - *[0-9a-f]+: a5a003e0 ld1rod {z0\.d}, p0/z, \[sp, x0\]
> + *[0-9a-f]+: a4bb17f1 ld1roh {z17\.h}, p5/z, \[sp, x27, lsl #1\]
> + *[0-9a-f]+: a4a003e0 ld1roh {z0\.h}, p0/z, \[sp, x0, lsl #1\]
> + *[0-9a-f]+: a53b17f1 ld1row {z17\.s}, p5/z, \[sp, x27, lsl #2\]
> + *[0-9a-f]+: a52003e0 ld1row {z0\.s}, p0/z, \[sp, x0, lsl #2\]
> + *[0-9a-f]+: a5bb17f1 ld1rod {z17\.d}, p5/z, \[sp, x27, lsl #3\]
> + *[0-9a-f]+: a5a003e0 ld1rod {z0\.d}, p0/z, \[sp, x0, lsl #3\]
> *[0-9a-f]+: a43b1411 ld1rob {z17\.b}, p5/z, \[x0, x27\]
> *[0-9a-f]+: a4200000 ld1rob {z0\.b}, p0/z, \[x0, x0\]
> - *[0-9a-f]+: a4bb1411 ld1roh {z17\.h}, p5/z, \[x0, x27\]
> - *[0-9a-f]+: a4a00000 ld1roh {z0\.h}, p0/z, \[x0, x0\]
> - *[0-9a-f]+: a53b1411 ld1row {z17\.s}, p5/z, \[x0, x27\]
> - *[0-9a-f]+: a5200000 ld1row {z0\.s}, p0/z, \[x0, x0\]
> - *[0-9a-f]+: a5bb1411 ld1rod {z17\.d}, p5/z, \[x0, x27\]
> - *[0-9a-f]+: a5a00000 ld1rod {z0\.d}, p0/z, \[x0, x0\]
> + *[0-9a-f]+: a4bb1411 ld1roh {z17\.h}, p5/z, \[x0, x27, lsl #1\]
> + *[0-9a-f]+: a4a00000 ld1roh {z0\.h}, p0/z, \[x0, x0, lsl #1\]
> + *[0-9a-f]+: a53b1411 ld1row {z17\.s}, p5/z, \[x0, x27, lsl #2\]
> + *[0-9a-f]+: a5200000 ld1row {z0\.s}, p0/z, \[x0, x0, lsl #2\]
> + *[0-9a-f]+: a5bb1411 ld1rod {z17\.d}, p5/z, \[x0, x27, lsl #3\]
> + *[0-9a-f]+: a5a00000 ld1rod {z0\.d}, p0/z, \[x0, x0, lsl #3\]
> *[0-9a-f]+: a42037f1 ld1rob {z17\.b}, p5/z, \[sp\]
> *[0-9a-f]+: a42723e0 ld1rob {z0\.b}, p0/z, \[sp, #224\]
> *[0-9a-f]+: a42823e0 ld1rob {z0\.b}, p0/z, \[sp, #-256\]
> --- a/gas/testsuite/gas/aarch64/f64mm.s
> +++ b/gas/testsuite/gas/aarch64/f64mm.s
> @@ -13,21 +13,21 @@ fmmla z0.d, z0.d, z0.d
>
> ld1rob { z17.b }, p5/z, [sp, x27]
> ld1rob { z0.b }, p0/z, [sp, x0]
> -ld1roh { z17.h }, p5/z, [sp, x27]
> -ld1roh { z0.h }, p0/z, [sp, x0]
> -ld1row { z17.s }, p5/z, [sp, x27]
> -ld1row { z0.s }, p0/z, [sp, x0]
> -ld1rod { z17.d }, p5/z, [sp, x27]
> -ld1rod { z0.d }, p0/z, [sp, x0]
> +ld1roh { z17.h }, p5/z, [sp, x27, lsl #1] ld1roh { z0.h }, p0/z, [sp,
> +x0, lsl #1] ld1row { z17.s }, p5/z, [sp, x27, lsl #2] ld1row { z0.s },
> +p0/z, [sp, x0, lsl #2] ld1rod { z17.d }, p5/z, [sp, x27, lsl #3] ld1rod
> +{ z0.d }, p0/z, [sp, x0, lsl #3]
>
> ld1rob { z17.b }, p5/z, [x0, x27]
> ld1rob { z0.b }, p0/z, [x0, x0]
> -ld1roh { z17.h }, p5/z, [x0, x27]
> -ld1roh { z0.h }, p0/z, [x0, x0]
> -ld1row { z17.s }, p5/z, [x0, x27]
> -ld1row { z0.s }, p0/z, [x0, x0]
> -ld1rod { z17.d }, p5/z, [x0, x27]
> -ld1rod { z0.d }, p0/z, [x0, x0]
> +ld1roh { z17.h }, p5/z, [x0, x27, lsl #1] ld1roh { z0.h }, p0/z, [x0,
> +x0, lsl #1] ld1row { z17.s }, p5/z, [x0, x27, lsl #2] ld1row { z0.s },
> +p0/z, [x0, x0, lsl #2] ld1rod { z17.d }, p5/z, [x0, x27, lsl #3] ld1rod
> +{ z0.d }, p0/z, [x0, x0, lsl #3]
>
> ld1rob { z17.b }, p5/z, [sp, #0]
> ld1rob { z0.b }, p0/z, [sp, #224]
> --- a/opcodes/aarch64-tbl.h
> +++ b/opcodes/aarch64-tbl.h
> @@ -5074,10 +5074,10 @@ struct aarch64_opcode aarch64_opcode_tab
> INT8MATMUL_SVE_INSNC ("sudot", 0x44a01c00, 0xffe0fc00, sve_misc,
> OP3 (SVE_Zd, SVE_Zn, SVE_Zm3_INDEX), OP_SVE_SBB, 0,
> C_SCAN_MOVPRFX, 0),
> F32MATMUL_SVE_INSNC ("fmmla", 0x64a0e400, 0xffe0fc00, sve_misc,
> OP3 (SVE_Zd, SVE_Zn, SVE_Zm_16), OP_SVE_VVV_S, 0, C_SCAN_MOVPRFX,
> 0),
> F64MATMUL_SVE_INSNC ("fmmla", 0x64e0e400, 0xffe0fc00, sve_misc,
> OP3 (SVE_Zd, SVE_Zn, SVE_Zm_16), OP_SVE_VVV_D, 0, C_SCAN_MOVPRFX,
> 0),
> - F64MATMUL_SVE_INSN ("ld1rob", 0xa4200000, 0xffe0e000, sve_misc, OP3
> (SVE_ZtxN, SVE_Pg3, SVE_ADDR_RX), OP_SVE_BZU, F_OD(1), 0),
> - F64MATMUL_SVE_INSN ("ld1roh", 0xa4a00000, 0xffe0e000, sve_misc, OP3
> (SVE_ZtxN, SVE_Pg3, SVE_ADDR_RX), OP_SVE_HZU, F_OD(1), 0),
> - F64MATMUL_SVE_INSN ("ld1row", 0xa5200000, 0xffe0e000, sve_misc,
> OP3 (SVE_ZtxN, SVE_Pg3, SVE_ADDR_RX), OP_SVE_SZU, F_OD(1), 0),
> - F64MATMUL_SVE_INSN ("ld1rod", 0xa5a00000, 0xffe0e000, sve_misc, OP3
> (SVE_ZtxN, SVE_Pg3, SVE_ADDR_RX), OP_SVE_DZU, F_OD(1), 0),
> + F64MATMUL_SVE_INSN ("ld1rob", 0xa4200000, 0xffe0e000, sve_misc,
> OP3
> + (SVE_ZtxN, SVE_Pg3, SVE_ADDR_RX), OP_SVE_BZU, F_OD(1), 0),
> + F64MATMUL_SVE_INSN ("ld1roh", 0xa4a00000, 0xffe0e000, sve_misc, OP3
> + (SVE_ZtxN, SVE_Pg3, SVE_ADDR_RX_LSL1), OP_SVE_HZU, F_OD(1), 0),
> + F64MATMUL_SVE_INSN ("ld1row", 0xa5200000, 0xffe0e000, sve_misc,
> OP3
> + (SVE_ZtxN, SVE_Pg3, SVE_ADDR_RX_LSL2), OP_SVE_SZU, F_OD(1), 0),
> + F64MATMUL_SVE_INSN ("ld1rod", 0xa5a00000, 0xffe0e000, sve_misc, OP3
> + (SVE_ZtxN, SVE_Pg3, SVE_ADDR_RX_LSL3), OP_SVE_DZU, F_OD(1), 0),
> F64MATMUL_SVE_INSN ("ld1rob", 0xa4202000, 0xfff0e000, sve_misc, OP3
> (SVE_ZtxN, SVE_Pg3, SVE_ADDR_RI_S4x32), OP_SVE_BZU, F_OD(1), 0),
> F64MATMUL_SVE_INSN ("ld1roh", 0xa4a02000, 0xfff0e000, sve_misc, OP3
> (SVE_ZtxN, SVE_Pg3, SVE_ADDR_RI_S4x32), OP_SVE_HZU, F_OD(1), 0),
> F64MATMUL_SVE_INSN ("ld1row", 0xa5202000, 0xfff0e000, sve_misc, OP3
> (SVE_ZtxN, SVE_Pg3, SVE_ADDR_RI_S4x32), OP_SVE_SZU, F_OD(1), 0),