@samitouri / QOSamiQemu / commits / 96a24f4462

target/arm: Implement FDOT (FP8 to FP32) for SVE

Reviewed-by: Peter Maydell <peter.maydell@linaro.org> Signed-off-by: Richard Henderson <richard.henderson@linaro.org> Message-id: 20260609192110.752384-36-richard.henderson@linaro.org Signed-off-by: Peter Maydell <peter.maydell@linaro.org>

Richard Henderson committed Jun 9, 2026 at 12:20 UTC 96a24f44622e6845a71c3480bfe7c23764adb05f
3 files changed +44
target/arm/cpu-features.h
+5
@@ -1575,6 +1575,11 @@ static inline bool isar_feature_aa64_ssve_f8fma(const ARMISARegisters *id)
1575 return FIELD_EX64_IDREG(id, ID_AA64SMFR0, SF8FMA);
1576 }
1577
1578 +static inline bool isar_feature_aa64_ssve_f8dp4(const ARMISARegisters *id)
1579 +{
1580 + return FIELD_EX64_IDREG(id, ID_AA64SMFR0, SF8DP4);
1581 +}
1582 +
1583 static inline bool isar_feature_aa64_sme_b16b16(const ARMISARegisters *id)
1584 {
1585 return FIELD_EX64_IDREG(id, ID_AA64SMFR0, B16B16);
target/arm/tcg/sve.decode
+4
@@ -1874,6 +1874,8 @@ FMLALL_sb 01100100 00 1 rm:5 10 idxn:2 10 rn:5 rd:5 &rxx idxm=0
1874 FDOT_zzzz 01100100 00 1 ..... 10 0 00 0 ..... ..... @rda_rn_rm_ex esz=2
1875 BFDOT_zzzz 01100100 01 1 ..... 10 0 00 0 ..... ..... @rda_rn_rm_ex esz=2
1876
1877 +FDOT_sb 01100100 01 1 ..... 10 0 00 1 ..... ..... @rda_rn_rm_ex esz=2
1878 +
1879 ### SVE2 floating-point multiply-add long (indexed)
1880
1881 FMLALB_zzxw 01100100 10 1 ..... 0100.0 ..... ..... @rrxr_3a esz=2
@@ -1897,6 +1899,8 @@ FMLALL_idx_sb 01100100 idxn:2 1 .. rm:3 1100 .. rn:5 rd:5 \
1899 FDOT_zzxz 01100100 00 1 ..... 010000 ..... ..... @rrxr_2 esz=2
1900 BFDOT_zzxz 01100100 01 1 ..... 010000 ..... ..... @rrxr_2 esz=2
1901
1902 +FDOT_idx_sb 01100100 01 1 ..... 010001 ..... ..... @rrxr_2 esz=2
1903 +
1904 ### SVE broadcast predicate element
1905
1906 &psel esz pd pn pm rv imm
target/arm/tcg/translate-sve.c
+35
@@ -8391,3 +8391,38 @@ TRANS(FMLAL_idx_hb, do_fmla_fp8, a, gen_helper_gvec_fmla_idx_hb)
8391
8392 TRANS(FMLALL_sb, do_fmla_fp8, a, gen_helper_gvec_fmla_sb)
8393 TRANS(FMLALL_idx_sb, do_fmla_fp8, a, gen_helper_gvec_fmla_idx_sb)
8394 +
8395 +static bool do_f8dp4(DisasContext *s, gen_helper_gvec_3_ptr *fn,
8396 + int rd, int rn, int rm, int index)
8397 +{
8398 + bool fp8dp4 = dc_isar_feature(aa64_f8dp4, s);
8399 + bool ssve_fp8dp4 = dc_isar_feature(aa64_ssve_f8dp4, s);
8400 + bool ok = false;
8401 +
8402 + /* Feature detection and enabling are complex here. */
8403 + if (!(ssve_fp8dp4 || (fp8dp4 && dc_isar_feature(aa64_sve2, s)))) {
8404 + return false;
8405 + }
8406 + if (fpmr_access_check(s)) {
8407 + if (fp8dp4) {
8408 + s->is_nonstreaming = !ssve_fp8dp4;
8409 + ok = sve_access_check(s);
8410 + } else {
8411 + ok = sme_sm_enabled_check(s);
8412 + }
8413 + }
8414 +
8415 + if (ok) {
8416 + unsigned vsz = vec_full_reg_size(s);
8417 + tcg_gen_gvec_3_ptr(vec_full_reg_offset(s, rd),
8418 + vec_full_reg_offset(s, rn),
8419 + vec_full_reg_offset(s, rm),
8420 + tcg_env, vsz, vsz,
8421 + index, fn);
8422 + }
8423 + return true;
8424 +}
8425 +
8426 +TRANS(FDOT_sb, do_f8dp4, gen_helper_gvec_fdot_sb, a->rd, a->rn, a->rm, 0)
8427 +TRANS(FDOT_idx_sb, do_f8dp4, gen_helper_gvec_fdot_idx_sb,
8428 + a->rd, a->rn, a->rm, a->index)