mirror of
https://github.com/izzy2lost/xemu.git
synced 2026-07-06 00:20:22 -07:00
Merge tag 'pull-loongarch-20230506' of https://gitlab.com/gaosong/qemu into staging
Add LoongArch LSX instructions. # -----BEGIN PGP SIGNATURE----- # # iLMEAAEIAB0WIQS4/x2g0v3LLaCcbCxAov/yOSY+3wUCZFXxGwAKCRBAov/yOSY+ # 39EoA/0Uy2DPz6g7J5+9tcIRk9jLrp36aYQJ9J8zRJd226YFvHSfiBWSIteMFOEX # Z0Jx1bL6N97KK/HA74Nx++x0kVuplEGp1s5cO/odL3gYy8RaJm23p9iaDa0D/UaB # ygLvXtuzN4unDFP5EF/wa9zRkDb7qX2iBBvc8OIal7eT4dDX+g== # =gyVU # -----END PGP SIGNATURE----- # gpg: Signature made Sat 06 May 2023 07:18:03 AM BST # gpg: using RSA key B8FF1DA0D2FDCB2DA09C6C2C40A2FFF239263EDF # gpg: Good signature from "Song Gao <m17746591750@163.com>" [unknown] # gpg: WARNING: This key is not certified with a trusted signature! # gpg: There is no indication that the signature belongs to the owner. # Primary key fingerprint: B8FF 1DA0 D2FD CB2D A09C 6C2C 40A2 FFF2 3926 3EDF * tag 'pull-loongarch-20230506' of https://gitlab.com/gaosong/qemu: (45 commits) hw/intc: don't use target_ulong for LoongArch ipi target/loongarch: CPUCFG support LSX target/loongarch: Use {set/get}_gpr replace to cpu_fpr target/loongarch: Implement vldi target/loongarch: Implement vld vst target/loongarch: Implement vilvl vilvh vextrins vshuf target/loongarch: Implement vreplve vpack vpick target/loongarch: Implement vinsgr2vr vpickve2gr vreplgr2vr target/loongarch: Implement vbitsel vset target/loongarch: Implement vfcmp target/loongarch: Implement vseq vsle vslt target/loongarch: Implement LSX fpu fcvt instructions target/loongarch: Implement LSX fpu arith instructions target/loongarch: Implement vfrstp target/loongarch: Implement vbitclr vbitset vbitrev target/loongarch: Implement vpcnt target/loongarch: Implement vclo vclz target/loongarch: Implement vssrlrn vssrarn target/loongarch: Implement vssrln vssran target/loongarch: Implement vsrlrn vsrarn ... Signed-off-by: Richard Henderson <richard.henderson@linaro.org>
This commit is contained in:
@@ -50,7 +50,7 @@ static uint64_t loongarch_ipi_readl(void *opaque, hwaddr addr, unsigned size)
|
||||
return ret;
|
||||
}
|
||||
|
||||
static void send_ipi_data(CPULoongArchState *env, target_ulong val, target_ulong addr)
|
||||
static void send_ipi_data(CPULoongArchState *env, uint64_t val, hwaddr addr)
|
||||
{
|
||||
int i, mask = 0, data = 0;
|
||||
|
||||
|
||||
@@ -128,7 +128,7 @@ static void setup_sigframe(CPULoongArchState *env,
|
||||
|
||||
fpu_ctx = (struct target_fpu_context *)(info + 1);
|
||||
for (i = 0; i < 32; ++i) {
|
||||
__put_user(env->fpr[i], &fpu_ctx->regs[i]);
|
||||
__put_user(env->fpr[i].vreg.D(0), &fpu_ctx->regs[i]);
|
||||
}
|
||||
__put_user(read_fcc(env), &fpu_ctx->fcc);
|
||||
__put_user(env->fcsr0, &fpu_ctx->fcsr);
|
||||
@@ -193,7 +193,7 @@ static void restore_sigframe(CPULoongArchState *env,
|
||||
uint64_t fcc;
|
||||
|
||||
for (i = 0; i < 32; ++i) {
|
||||
__get_user(env->fpr[i], &fpu_ctx->regs[i]);
|
||||
__get_user(env->fpr[i].vreg.D(0), &fpu_ctx->regs[i]);
|
||||
}
|
||||
__get_user(fcc, &fpu_ctx->fcc);
|
||||
write_fcc(env, fcc);
|
||||
|
||||
@@ -52,6 +52,7 @@ static const char * const excp_names[] = {
|
||||
[EXCCODE_FPE] = "Floating Point Exception",
|
||||
[EXCCODE_DBP] = "Debug breakpoint",
|
||||
[EXCCODE_BCE] = "Bound Check Exception",
|
||||
[EXCCODE_SXD] = "128 bit vector instructions Disable exception",
|
||||
};
|
||||
|
||||
const char *loongarch_exception_name(int32_t exception)
|
||||
@@ -187,6 +188,7 @@ static void loongarch_cpu_do_interrupt(CPUState *cs)
|
||||
case EXCCODE_FPD:
|
||||
case EXCCODE_FPE:
|
||||
case EXCCODE_BCE:
|
||||
case EXCCODE_SXD:
|
||||
env->CSR_BADV = env->pc;
|
||||
QEMU_FALLTHROUGH;
|
||||
case EXCCODE_ADEM:
|
||||
@@ -386,6 +388,7 @@ static void loongarch_la464_initfn(Object *obj)
|
||||
data = FIELD_DP32(data, CPUCFG2, FP_SP, 1);
|
||||
data = FIELD_DP32(data, CPUCFG2, FP_DP, 1);
|
||||
data = FIELD_DP32(data, CPUCFG2, FP_VER, 1);
|
||||
data = FIELD_DP32(data, CPUCFG2, LSX, 1),
|
||||
data = FIELD_DP32(data, CPUCFG2, LLFTP, 1);
|
||||
data = FIELD_DP32(data, CPUCFG2, LLFTP_VER, 1);
|
||||
data = FIELD_DP32(data, CPUCFG2, LAM, 1);
|
||||
@@ -656,7 +659,7 @@ void loongarch_cpu_dump_state(CPUState *cs, FILE *f, int flags)
|
||||
/* fpr */
|
||||
if (flags & CPU_DUMP_FPU) {
|
||||
for (i = 0; i < 32; i++) {
|
||||
qemu_fprintf(f, " %s %016" PRIx64, fregnames[i], env->fpr[i]);
|
||||
qemu_fprintf(f, " %s %016" PRIx64, fregnames[i], env->fpr[i].vreg.D(0));
|
||||
if ((i & 3) == 3) {
|
||||
qemu_fprintf(f, "\n");
|
||||
}
|
||||
|
||||
+26
-1
@@ -8,6 +8,7 @@
|
||||
#ifndef LOONGARCH_CPU_H
|
||||
#define LOONGARCH_CPU_H
|
||||
|
||||
#include "qemu/int128.h"
|
||||
#include "exec/cpu-defs.h"
|
||||
#include "fpu/softfloat-types.h"
|
||||
#include "hw/registerfields.h"
|
||||
@@ -54,6 +55,10 @@ FIELD(FCSR0, CAUSE, 24, 5)
|
||||
do { \
|
||||
(REG) = FIELD_DP32(REG, FCSR0, CAUSE, V); \
|
||||
} while (0)
|
||||
#define UPDATE_FP_CAUSE(REG, V) \
|
||||
do { \
|
||||
(REG) |= FIELD_DP32(0, FCSR0, CAUSE, V); \
|
||||
} while (0)
|
||||
|
||||
#define GET_FP_ENABLES(REG) FIELD_EX32(REG, FCSR0, ENABLES)
|
||||
#define SET_FP_ENABLES(REG, V) \
|
||||
@@ -241,6 +246,24 @@ FIELD(TLB_MISC, ASID, 1, 10)
|
||||
FIELD(TLB_MISC, VPPN, 13, 35)
|
||||
FIELD(TLB_MISC, PS, 48, 6)
|
||||
|
||||
#define LSX_LEN (128)
|
||||
typedef union VReg {
|
||||
int8_t B[LSX_LEN / 8];
|
||||
int16_t H[LSX_LEN / 16];
|
||||
int32_t W[LSX_LEN / 32];
|
||||
int64_t D[LSX_LEN / 64];
|
||||
uint8_t UB[LSX_LEN / 8];
|
||||
uint16_t UH[LSX_LEN / 16];
|
||||
uint32_t UW[LSX_LEN / 32];
|
||||
uint64_t UD[LSX_LEN / 64];
|
||||
Int128 Q[LSX_LEN / 128];
|
||||
}VReg;
|
||||
|
||||
typedef union fpr_t fpr_t;
|
||||
union fpr_t {
|
||||
VReg vreg;
|
||||
};
|
||||
|
||||
struct LoongArchTLB {
|
||||
uint64_t tlb_misc;
|
||||
/* Fields corresponding to CSR_TLBELO0/1 */
|
||||
@@ -253,7 +276,7 @@ typedef struct CPUArchState {
|
||||
uint64_t gpr[32];
|
||||
uint64_t pc;
|
||||
|
||||
uint64_t fpr[32];
|
||||
fpr_t fpr[32];
|
||||
float_status fp_status;
|
||||
bool cf[8];
|
||||
|
||||
@@ -400,6 +423,7 @@ static inline int cpu_mmu_index(CPULoongArchState *env, bool ifetch)
|
||||
#define HW_FLAGS_PLV_MASK R_CSR_CRMD_PLV_MASK /* 0x03 */
|
||||
#define HW_FLAGS_CRMD_PG R_CSR_CRMD_PG_MASK /* 0x10 */
|
||||
#define HW_FLAGS_EUEN_FPE 0x04
|
||||
#define HW_FLAGS_EUEN_SXE 0x08
|
||||
|
||||
static inline void cpu_get_tb_cpu_state(CPULoongArchState *env,
|
||||
target_ulong *pc,
|
||||
@@ -410,6 +434,7 @@ static inline void cpu_get_tb_cpu_state(CPULoongArchState *env,
|
||||
*cs_base = 0;
|
||||
*flags = env->CSR_CRMD & (R_CSR_CRMD_PLV_MASK | R_CSR_CRMD_PG_MASK);
|
||||
*flags |= FIELD_EX64(env->CSR_EUEN, CSR_EUEN, FPE) * HW_FLAGS_EUEN_FPE;
|
||||
*flags |= FIELD_EX64(env->CSR_EUEN, CSR_EUEN, SXE) * HW_FLAGS_EUEN_SXE;
|
||||
}
|
||||
|
||||
void loongarch_cpu_list(void);
|
||||
|
||||
File diff suppressed because it is too large
Load Diff
@@ -33,7 +33,7 @@ void restore_fp_status(CPULoongArchState *env)
|
||||
set_flush_to_zero(0, &env->fp_status);
|
||||
}
|
||||
|
||||
static int ieee_ex_to_loongarch(int xcpt)
|
||||
int ieee_ex_to_loongarch(int xcpt)
|
||||
{
|
||||
int ret = 0;
|
||||
if (xcpt & float_flag_invalid) {
|
||||
|
||||
@@ -69,7 +69,7 @@ static int loongarch_gdb_get_fpu(CPULoongArchState *env,
|
||||
GByteArray *mem_buf, int n)
|
||||
{
|
||||
if (0 <= n && n < 32) {
|
||||
return gdb_get_reg64(mem_buf, env->fpr[n]);
|
||||
return gdb_get_reg64(mem_buf, env->fpr[n].vreg.D(0));
|
||||
} else if (n == 32) {
|
||||
uint64_t val = read_fcc(env);
|
||||
return gdb_get_reg64(mem_buf, val);
|
||||
@@ -85,7 +85,7 @@ static int loongarch_gdb_set_fpu(CPULoongArchState *env,
|
||||
int length = 0;
|
||||
|
||||
if (0 <= n && n < 32) {
|
||||
env->fpr[n] = ldq_p(mem_buf);
|
||||
env->fpr[n].vreg.D(0) = ldq_p(mem_buf);
|
||||
length = 8;
|
||||
} else if (n == 32) {
|
||||
uint64_t val = ldq_p(mem_buf);
|
||||
|
||||
File diff suppressed because it is too large
Load Diff
@@ -17,18 +17,29 @@
|
||||
static bool gen_fff(DisasContext *ctx, arg_fff *a,
|
||||
void (*func)(TCGv, TCGv_env, TCGv, TCGv))
|
||||
{
|
||||
TCGv dest = get_fpr(ctx, a->fd);
|
||||
TCGv src1 = get_fpr(ctx, a->fj);
|
||||
TCGv src2 = get_fpr(ctx, a->fk);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
func(cpu_fpr[a->fd], cpu_env, cpu_fpr[a->fj], cpu_fpr[a->fk]);
|
||||
func(dest, cpu_env, src1, src2);
|
||||
set_fpr(a->fd, dest);
|
||||
|
||||
return true;
|
||||
}
|
||||
|
||||
static bool gen_ff(DisasContext *ctx, arg_ff *a,
|
||||
void (*func)(TCGv, TCGv_env, TCGv))
|
||||
{
|
||||
TCGv dest = get_fpr(ctx, a->fd);
|
||||
TCGv src = get_fpr(ctx, a->fj);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
func(cpu_fpr[a->fd], cpu_env, cpu_fpr[a->fj]);
|
||||
func(dest, cpu_env, src);
|
||||
set_fpr(a->fd, dest);
|
||||
|
||||
return true;
|
||||
}
|
||||
|
||||
@@ -37,61 +48,98 @@ static bool gen_muladd(DisasContext *ctx, arg_ffff *a,
|
||||
int flag)
|
||||
{
|
||||
TCGv_i32 tflag = tcg_constant_i32(flag);
|
||||
TCGv dest = get_fpr(ctx, a->fd);
|
||||
TCGv src1 = get_fpr(ctx, a->fj);
|
||||
TCGv src2 = get_fpr(ctx, a->fk);
|
||||
TCGv src3 = get_fpr(ctx, a->fa);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
func(cpu_fpr[a->fd], cpu_env, cpu_fpr[a->fj],
|
||||
cpu_fpr[a->fk], cpu_fpr[a->fa], tflag);
|
||||
func(dest, cpu_env, src1, src2, src3, tflag);
|
||||
set_fpr(a->fd, dest);
|
||||
|
||||
return true;
|
||||
}
|
||||
|
||||
static bool trans_fcopysign_s(DisasContext *ctx, arg_fcopysign_s *a)
|
||||
{
|
||||
TCGv dest = get_fpr(ctx, a->fd);
|
||||
TCGv src1 = get_fpr(ctx, a->fk);
|
||||
TCGv src2 = get_fpr(ctx, a->fj);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
tcg_gen_deposit_i64(cpu_fpr[a->fd], cpu_fpr[a->fk], cpu_fpr[a->fj], 0, 31);
|
||||
tcg_gen_deposit_i64(dest, src1, src2, 0, 31);
|
||||
set_fpr(a->fd, dest);
|
||||
|
||||
return true;
|
||||
}
|
||||
|
||||
static bool trans_fcopysign_d(DisasContext *ctx, arg_fcopysign_d *a)
|
||||
{
|
||||
TCGv dest = get_fpr(ctx, a->fd);
|
||||
TCGv src1 = get_fpr(ctx, a->fk);
|
||||
TCGv src2 = get_fpr(ctx, a->fj);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
tcg_gen_deposit_i64(cpu_fpr[a->fd], cpu_fpr[a->fk], cpu_fpr[a->fj], 0, 63);
|
||||
tcg_gen_deposit_i64(dest, src1, src2, 0, 63);
|
||||
set_fpr(a->fd, dest);
|
||||
|
||||
return true;
|
||||
}
|
||||
|
||||
static bool trans_fabs_s(DisasContext *ctx, arg_fabs_s *a)
|
||||
{
|
||||
TCGv dest = get_fpr(ctx, a->fd);
|
||||
TCGv src = get_fpr(ctx, a->fj);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
tcg_gen_andi_i64(cpu_fpr[a->fd], cpu_fpr[a->fj], MAKE_64BIT_MASK(0, 31));
|
||||
gen_nanbox_s(cpu_fpr[a->fd], cpu_fpr[a->fd]);
|
||||
tcg_gen_andi_i64(dest, src, MAKE_64BIT_MASK(0, 31));
|
||||
gen_nanbox_s(dest, dest);
|
||||
set_fpr(a->fd, dest);
|
||||
|
||||
return true;
|
||||
}
|
||||
|
||||
static bool trans_fabs_d(DisasContext *ctx, arg_fabs_d *a)
|
||||
{
|
||||
TCGv dest = get_fpr(ctx, a->fd);
|
||||
TCGv src = get_fpr(ctx, a->fj);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
tcg_gen_andi_i64(cpu_fpr[a->fd], cpu_fpr[a->fj], MAKE_64BIT_MASK(0, 63));
|
||||
tcg_gen_andi_i64(dest, src, MAKE_64BIT_MASK(0, 63));
|
||||
set_fpr(a->fd, dest);
|
||||
|
||||
return true;
|
||||
}
|
||||
|
||||
static bool trans_fneg_s(DisasContext *ctx, arg_fneg_s *a)
|
||||
{
|
||||
TCGv dest = get_fpr(ctx, a->fd);
|
||||
TCGv src = get_fpr(ctx, a->fj);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
tcg_gen_xori_i64(cpu_fpr[a->fd], cpu_fpr[a->fj], 0x80000000);
|
||||
gen_nanbox_s(cpu_fpr[a->fd], cpu_fpr[a->fd]);
|
||||
tcg_gen_xori_i64(dest, src, 0x80000000);
|
||||
gen_nanbox_s(dest, dest);
|
||||
set_fpr(a->fd, dest);
|
||||
|
||||
return true;
|
||||
}
|
||||
|
||||
static bool trans_fneg_d(DisasContext *ctx, arg_fneg_d *a)
|
||||
{
|
||||
TCGv dest = get_fpr(ctx, a->fd);
|
||||
TCGv src = get_fpr(ctx, a->fj);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
tcg_gen_xori_i64(cpu_fpr[a->fd], cpu_fpr[a->fj], 0x8000000000000000LL);
|
||||
tcg_gen_xori_i64(dest, src, 0x8000000000000000LL);
|
||||
set_fpr(a->fd, dest);
|
||||
|
||||
return true;
|
||||
}
|
||||
|
||||
|
||||
@@ -25,17 +25,19 @@ static uint32_t get_fcmp_flags(int cond)
|
||||
|
||||
static bool trans_fcmp_cond_s(DisasContext *ctx, arg_fcmp_cond_s *a)
|
||||
{
|
||||
TCGv var;
|
||||
TCGv var, src1, src2;
|
||||
uint32_t flags;
|
||||
void (*fn)(TCGv, TCGv_env, TCGv, TCGv, TCGv_i32);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
var = tcg_temp_new();
|
||||
src1 = get_fpr(ctx, a->fj);
|
||||
src2 = get_fpr(ctx, a->fk);
|
||||
fn = (a->fcond & 1 ? gen_helper_fcmp_s_s : gen_helper_fcmp_c_s);
|
||||
flags = get_fcmp_flags(a->fcond >> 1);
|
||||
|
||||
fn(var, cpu_env, cpu_fpr[a->fj], cpu_fpr[a->fk], tcg_constant_i32(flags));
|
||||
fn(var, cpu_env, src1, src2, tcg_constant_i32(flags));
|
||||
|
||||
tcg_gen_st8_tl(var, cpu_env, offsetof(CPULoongArchState, cf[a->cd]));
|
||||
return true;
|
||||
@@ -43,17 +45,19 @@ static bool trans_fcmp_cond_s(DisasContext *ctx, arg_fcmp_cond_s *a)
|
||||
|
||||
static bool trans_fcmp_cond_d(DisasContext *ctx, arg_fcmp_cond_d *a)
|
||||
{
|
||||
TCGv var;
|
||||
TCGv var, src1, src2;
|
||||
uint32_t flags;
|
||||
void (*fn)(TCGv, TCGv_env, TCGv, TCGv, TCGv_i32);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
var = tcg_temp_new();
|
||||
src1 = get_fpr(ctx, a->fj);
|
||||
src2 = get_fpr(ctx, a->fk);
|
||||
fn = (a->fcond & 1 ? gen_helper_fcmp_s_d : gen_helper_fcmp_c_d);
|
||||
flags = get_fcmp_flags(a->fcond >> 1);
|
||||
|
||||
fn(var, cpu_env, cpu_fpr[a->fj], cpu_fpr[a->fk], tcg_constant_i32(flags));
|
||||
fn(var, cpu_env, src1, src2, tcg_constant_i32(flags));
|
||||
|
||||
tcg_gen_st8_tl(var, cpu_env, offsetof(CPULoongArchState, cf[a->cd]));
|
||||
return true;
|
||||
|
||||
@@ -13,6 +13,7 @@ static void maybe_nanbox_load(TCGv freg, MemOp mop)
|
||||
static bool gen_fload_i(DisasContext *ctx, arg_fr_i *a, MemOp mop)
|
||||
{
|
||||
TCGv addr = gpr_src(ctx, a->rj, EXT_NONE);
|
||||
TCGv dest = get_fpr(ctx, a->fd);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
@@ -22,8 +23,9 @@ static bool gen_fload_i(DisasContext *ctx, arg_fr_i *a, MemOp mop)
|
||||
addr = temp;
|
||||
}
|
||||
|
||||
tcg_gen_qemu_ld_tl(cpu_fpr[a->fd], addr, ctx->mem_idx, mop);
|
||||
maybe_nanbox_load(cpu_fpr[a->fd], mop);
|
||||
tcg_gen_qemu_ld_tl(dest, addr, ctx->mem_idx, mop);
|
||||
maybe_nanbox_load(dest, mop);
|
||||
set_fpr(a->fd, dest);
|
||||
|
||||
return true;
|
||||
}
|
||||
@@ -31,6 +33,7 @@ static bool gen_fload_i(DisasContext *ctx, arg_fr_i *a, MemOp mop)
|
||||
static bool gen_fstore_i(DisasContext *ctx, arg_fr_i *a, MemOp mop)
|
||||
{
|
||||
TCGv addr = gpr_src(ctx, a->rj, EXT_NONE);
|
||||
TCGv src = get_fpr(ctx, a->fd);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
@@ -40,7 +43,8 @@ static bool gen_fstore_i(DisasContext *ctx, arg_fr_i *a, MemOp mop)
|
||||
addr = temp;
|
||||
}
|
||||
|
||||
tcg_gen_qemu_st_tl(cpu_fpr[a->fd], addr, ctx->mem_idx, mop);
|
||||
tcg_gen_qemu_st_tl(src, addr, ctx->mem_idx, mop);
|
||||
|
||||
return true;
|
||||
}
|
||||
|
||||
@@ -48,14 +52,16 @@ static bool gen_floadx(DisasContext *ctx, arg_frr *a, MemOp mop)
|
||||
{
|
||||
TCGv src1 = gpr_src(ctx, a->rj, EXT_NONE);
|
||||
TCGv src2 = gpr_src(ctx, a->rk, EXT_NONE);
|
||||
TCGv dest = get_fpr(ctx, a->fd);
|
||||
TCGv addr;
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
addr = tcg_temp_new();
|
||||
tcg_gen_add_tl(addr, src1, src2);
|
||||
tcg_gen_qemu_ld_tl(cpu_fpr[a->fd], addr, ctx->mem_idx, mop);
|
||||
maybe_nanbox_load(cpu_fpr[a->fd], mop);
|
||||
tcg_gen_qemu_ld_tl(dest, addr, ctx->mem_idx, mop);
|
||||
maybe_nanbox_load(dest, mop);
|
||||
set_fpr(a->fd, dest);
|
||||
|
||||
return true;
|
||||
}
|
||||
@@ -64,13 +70,14 @@ static bool gen_fstorex(DisasContext *ctx, arg_frr *a, MemOp mop)
|
||||
{
|
||||
TCGv src1 = gpr_src(ctx, a->rj, EXT_NONE);
|
||||
TCGv src2 = gpr_src(ctx, a->rk, EXT_NONE);
|
||||
TCGv src3 = get_fpr(ctx, a->fd);
|
||||
TCGv addr;
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
addr = tcg_temp_new();
|
||||
tcg_gen_add_tl(addr, src1, src2);
|
||||
tcg_gen_qemu_st_tl(cpu_fpr[a->fd], addr, ctx->mem_idx, mop);
|
||||
tcg_gen_qemu_st_tl(src3, addr, ctx->mem_idx, mop);
|
||||
|
||||
return true;
|
||||
}
|
||||
@@ -79,6 +86,7 @@ static bool gen_fload_gt(DisasContext *ctx, arg_frr *a, MemOp mop)
|
||||
{
|
||||
TCGv src1 = gpr_src(ctx, a->rj, EXT_NONE);
|
||||
TCGv src2 = gpr_src(ctx, a->rk, EXT_NONE);
|
||||
TCGv dest = get_fpr(ctx, a->fd);
|
||||
TCGv addr;
|
||||
|
||||
CHECK_FPE;
|
||||
@@ -86,8 +94,9 @@ static bool gen_fload_gt(DisasContext *ctx, arg_frr *a, MemOp mop)
|
||||
addr = tcg_temp_new();
|
||||
gen_helper_asrtgt_d(cpu_env, src1, src2);
|
||||
tcg_gen_add_tl(addr, src1, src2);
|
||||
tcg_gen_qemu_ld_tl(cpu_fpr[a->fd], addr, ctx->mem_idx, mop);
|
||||
maybe_nanbox_load(cpu_fpr[a->fd], mop);
|
||||
tcg_gen_qemu_ld_tl(dest, addr, ctx->mem_idx, mop);
|
||||
maybe_nanbox_load(dest, mop);
|
||||
set_fpr(a->fd, dest);
|
||||
|
||||
return true;
|
||||
}
|
||||
@@ -96,6 +105,7 @@ static bool gen_fstore_gt(DisasContext *ctx, arg_frr *a, MemOp mop)
|
||||
{
|
||||
TCGv src1 = gpr_src(ctx, a->rj, EXT_NONE);
|
||||
TCGv src2 = gpr_src(ctx, a->rk, EXT_NONE);
|
||||
TCGv src3 = get_fpr(ctx, a->fd);
|
||||
TCGv addr;
|
||||
|
||||
CHECK_FPE;
|
||||
@@ -103,7 +113,7 @@ static bool gen_fstore_gt(DisasContext *ctx, arg_frr *a, MemOp mop)
|
||||
addr = tcg_temp_new();
|
||||
gen_helper_asrtgt_d(cpu_env, src1, src2);
|
||||
tcg_gen_add_tl(addr, src1, src2);
|
||||
tcg_gen_qemu_st_tl(cpu_fpr[a->fd], addr, ctx->mem_idx, mop);
|
||||
tcg_gen_qemu_st_tl(src3, addr, ctx->mem_idx, mop);
|
||||
|
||||
return true;
|
||||
}
|
||||
@@ -112,6 +122,7 @@ static bool gen_fload_le(DisasContext *ctx, arg_frr *a, MemOp mop)
|
||||
{
|
||||
TCGv src1 = gpr_src(ctx, a->rj, EXT_NONE);
|
||||
TCGv src2 = gpr_src(ctx, a->rk, EXT_NONE);
|
||||
TCGv dest = get_fpr(ctx, a->fd);
|
||||
TCGv addr;
|
||||
|
||||
CHECK_FPE;
|
||||
@@ -119,8 +130,9 @@ static bool gen_fload_le(DisasContext *ctx, arg_frr *a, MemOp mop)
|
||||
addr = tcg_temp_new();
|
||||
gen_helper_asrtle_d(cpu_env, src1, src2);
|
||||
tcg_gen_add_tl(addr, src1, src2);
|
||||
tcg_gen_qemu_ld_tl(cpu_fpr[a->fd], addr, ctx->mem_idx, mop);
|
||||
maybe_nanbox_load(cpu_fpr[a->fd], mop);
|
||||
tcg_gen_qemu_ld_tl(dest, addr, ctx->mem_idx, mop);
|
||||
maybe_nanbox_load(dest, mop);
|
||||
set_fpr(a->fd, dest);
|
||||
|
||||
return true;
|
||||
}
|
||||
@@ -129,6 +141,7 @@ static bool gen_fstore_le(DisasContext *ctx, arg_frr *a, MemOp mop)
|
||||
{
|
||||
TCGv src1 = gpr_src(ctx, a->rj, EXT_NONE);
|
||||
TCGv src2 = gpr_src(ctx, a->rk, EXT_NONE);
|
||||
TCGv src3 = get_fpr(ctx, a->fd);
|
||||
TCGv addr;
|
||||
|
||||
CHECK_FPE;
|
||||
@@ -136,7 +149,7 @@ static bool gen_fstore_le(DisasContext *ctx, arg_frr *a, MemOp mop)
|
||||
addr = tcg_temp_new();
|
||||
gen_helper_asrtle_d(cpu_env, src1, src2);
|
||||
tcg_gen_add_tl(addr, src1, src2);
|
||||
tcg_gen_qemu_st_tl(cpu_fpr[a->fd], addr, ctx->mem_idx, mop);
|
||||
tcg_gen_qemu_st_tl(src3, addr, ctx->mem_idx, mop);
|
||||
|
||||
return true;
|
||||
}
|
||||
|
||||
@@ -10,14 +10,17 @@ static const uint32_t fcsr_mask[4] = {
|
||||
static bool trans_fsel(DisasContext *ctx, arg_fsel *a)
|
||||
{
|
||||
TCGv zero = tcg_constant_tl(0);
|
||||
TCGv dest = get_fpr(ctx, a->fd);
|
||||
TCGv src1 = get_fpr(ctx, a->fj);
|
||||
TCGv src2 = get_fpr(ctx, a->fk);
|
||||
TCGv cond;
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
cond = tcg_temp_new();
|
||||
tcg_gen_ld8u_tl(cond, cpu_env, offsetof(CPULoongArchState, cf[a->ca]));
|
||||
tcg_gen_movcond_tl(TCG_COND_EQ, cpu_fpr[a->fd], cond, zero,
|
||||
cpu_fpr[a->fj], cpu_fpr[a->fk]);
|
||||
tcg_gen_movcond_tl(TCG_COND_EQ, dest, cond, zero, src1, src2);
|
||||
set_fpr(a->fd, dest);
|
||||
|
||||
return true;
|
||||
}
|
||||
@@ -25,15 +28,16 @@ static bool trans_fsel(DisasContext *ctx, arg_fsel *a)
|
||||
static bool gen_f2f(DisasContext *ctx, arg_ff *a,
|
||||
void (*func)(TCGv, TCGv), bool nanbox)
|
||||
{
|
||||
TCGv dest = cpu_fpr[a->fd];
|
||||
TCGv src = cpu_fpr[a->fj];
|
||||
TCGv dest = get_fpr(ctx, a->fd);
|
||||
TCGv src = get_fpr(ctx, a->fj);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
func(dest, src);
|
||||
if (nanbox) {
|
||||
gen_nanbox_s(cpu_fpr[a->fd], cpu_fpr[a->fd]);
|
||||
gen_nanbox_s(dest, dest);
|
||||
}
|
||||
set_fpr(a->fd, dest);
|
||||
|
||||
return true;
|
||||
}
|
||||
@@ -42,10 +46,13 @@ static bool gen_r2f(DisasContext *ctx, arg_fr *a,
|
||||
void (*func)(TCGv, TCGv))
|
||||
{
|
||||
TCGv src = gpr_src(ctx, a->rj, EXT_NONE);
|
||||
TCGv dest = get_fpr(ctx, a->fd);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
func(cpu_fpr[a->fd], src);
|
||||
func(dest, src);
|
||||
set_fpr(a->fd, dest);
|
||||
|
||||
return true;
|
||||
}
|
||||
|
||||
@@ -53,10 +60,11 @@ static bool gen_f2r(DisasContext *ctx, arg_rf *a,
|
||||
void (*func)(TCGv, TCGv))
|
||||
{
|
||||
TCGv dest = gpr_dst(ctx, a->rd, EXT_NONE);
|
||||
TCGv src = get_fpr(ctx, a->fj);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
func(dest, cpu_fpr[a->fj]);
|
||||
func(dest, src);
|
||||
gen_set_gpr(a->rd, dest, EXT_NONE);
|
||||
|
||||
return true;
|
||||
@@ -124,11 +132,12 @@ static void gen_movfrh2gr_s(TCGv dest, TCGv src)
|
||||
static bool trans_movfr2cf(DisasContext *ctx, arg_movfr2cf *a)
|
||||
{
|
||||
TCGv t0;
|
||||
TCGv src = get_fpr(ctx, a->fj);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
t0 = tcg_temp_new();
|
||||
tcg_gen_andi_tl(t0, cpu_fpr[a->fj], 0x1);
|
||||
tcg_gen_andi_tl(t0, src, 0x1);
|
||||
tcg_gen_st8_tl(t0, cpu_env, offsetof(CPULoongArchState, cf[a->cd & 0x7]));
|
||||
|
||||
return true;
|
||||
@@ -136,10 +145,14 @@ static bool trans_movfr2cf(DisasContext *ctx, arg_movfr2cf *a)
|
||||
|
||||
static bool trans_movcf2fr(DisasContext *ctx, arg_movcf2fr *a)
|
||||
{
|
||||
TCGv dest = get_fpr(ctx, a->fd);
|
||||
|
||||
CHECK_FPE;
|
||||
|
||||
tcg_gen_ld8u_tl(cpu_fpr[a->fd], cpu_env,
|
||||
tcg_gen_ld8u_tl(dest, cpu_env,
|
||||
offsetof(CPULoongArchState, cf[a->cj & 0x7]));
|
||||
set_fpr(a->fd, dest);
|
||||
|
||||
return true;
|
||||
}
|
||||
|
||||
|
||||
File diff suppressed because it is too large
Load Diff
File diff suppressed because it is too large
Load Diff
@@ -21,6 +21,28 @@
|
||||
/* Global bit for huge page */
|
||||
#define LOONGARCH_HGLOBAL_SHIFT 12
|
||||
|
||||
#if HOST_BIG_ENDIAN
|
||||
#define B(x) B[15 - (x)]
|
||||
#define H(x) H[7 - (x)]
|
||||
#define W(x) W[3 - (x)]
|
||||
#define D(x) D[1 - (x)]
|
||||
#define UB(x) UB[15 - (x)]
|
||||
#define UH(x) UH[7 - (x)]
|
||||
#define UW(x) UW[3 - (x)]
|
||||
#define UD(x) UD[1 -(x)]
|
||||
#define Q(x) Q[x]
|
||||
#else
|
||||
#define B(x) B[x]
|
||||
#define H(x) H[x]
|
||||
#define W(x) W[x]
|
||||
#define D(x) D[x]
|
||||
#define UB(x) UB[x]
|
||||
#define UH(x) UH[x]
|
||||
#define UW(x) UW[x]
|
||||
#define UD(x) UD[x]
|
||||
#define Q(x) Q[x]
|
||||
#endif
|
||||
|
||||
void loongarch_translate_init(void);
|
||||
|
||||
void loongarch_cpu_dump_state(CPUState *cpu, FILE *f, int flags);
|
||||
@@ -31,6 +53,7 @@ void G_NORETURN do_raise_exception(CPULoongArchState *env,
|
||||
|
||||
const char *loongarch_exception_name(int32_t exception);
|
||||
|
||||
int ieee_ex_to_loongarch(int xcpt);
|
||||
void restore_fp_status(CPULoongArchState *env);
|
||||
|
||||
#ifndef CONFIG_USER_ONLY
|
||||
|
||||
File diff suppressed because it is too large
Load Diff
@@ -10,6 +10,72 @@
|
||||
#include "migration/cpu.h"
|
||||
#include "internals.h"
|
||||
|
||||
static const VMStateDescription vmstate_fpu_reg = {
|
||||
.name = "fpu_reg",
|
||||
.version_id = 1,
|
||||
.minimum_version_id = 1,
|
||||
.fields = (VMStateField[]) {
|
||||
VMSTATE_UINT64(UD(0), VReg),
|
||||
VMSTATE_END_OF_LIST()
|
||||
}
|
||||
};
|
||||
|
||||
#define VMSTATE_FPU_REGS(_field, _state, _start) \
|
||||
VMSTATE_STRUCT_SUB_ARRAY(_field, _state, _start, 32, 0, \
|
||||
vmstate_fpu_reg, fpr_t)
|
||||
|
||||
static bool fpu_needed(void *opaque)
|
||||
{
|
||||
LoongArchCPU *cpu = opaque;
|
||||
|
||||
return FIELD_EX64(cpu->env.cpucfg[2], CPUCFG2, FP);
|
||||
}
|
||||
|
||||
static const VMStateDescription vmstate_fpu = {
|
||||
.name = "cpu/fpu",
|
||||
.version_id = 1,
|
||||
.minimum_version_id = 1,
|
||||
.needed = fpu_needed,
|
||||
.fields = (VMStateField[]) {
|
||||
VMSTATE_FPU_REGS(env.fpr, LoongArchCPU, 0),
|
||||
VMSTATE_UINT32(env.fcsr0, LoongArchCPU),
|
||||
VMSTATE_BOOL_ARRAY(env.cf, LoongArchCPU, 8),
|
||||
VMSTATE_END_OF_LIST()
|
||||
},
|
||||
};
|
||||
|
||||
static const VMStateDescription vmstate_lsxh_reg = {
|
||||
.name = "lsxh_reg",
|
||||
.version_id = 1,
|
||||
.minimum_version_id = 1,
|
||||
.fields = (VMStateField[]) {
|
||||
VMSTATE_UINT64(UD(1), VReg),
|
||||
VMSTATE_END_OF_LIST()
|
||||
}
|
||||
};
|
||||
|
||||
#define VMSTATE_LSXH_REGS(_field, _state, _start) \
|
||||
VMSTATE_STRUCT_SUB_ARRAY(_field, _state, _start, 32, 0, \
|
||||
vmstate_lsxh_reg, fpr_t)
|
||||
|
||||
static bool lsx_needed(void *opaque)
|
||||
{
|
||||
LoongArchCPU *cpu = opaque;
|
||||
|
||||
return FIELD_EX64(cpu->env.cpucfg[2], CPUCFG2, LSX);
|
||||
}
|
||||
|
||||
static const VMStateDescription vmstate_lsx = {
|
||||
.name = "cpu/lsx",
|
||||
.version_id = 1,
|
||||
.minimum_version_id = 1,
|
||||
.needed = lsx_needed,
|
||||
.fields = (VMStateField[]) {
|
||||
VMSTATE_LSXH_REGS(env.fpr, LoongArchCPU, 0),
|
||||
VMSTATE_END_OF_LIST()
|
||||
},
|
||||
};
|
||||
|
||||
/* TLB state */
|
||||
const VMStateDescription vmstate_tlb = {
|
||||
.name = "cpu/tlb",
|
||||
@@ -24,18 +90,13 @@ const VMStateDescription vmstate_tlb = {
|
||||
};
|
||||
|
||||
/* LoongArch CPU state */
|
||||
|
||||
const VMStateDescription vmstate_loongarch_cpu = {
|
||||
.name = "cpu",
|
||||
.version_id = 0,
|
||||
.minimum_version_id = 0,
|
||||
.version_id = 1,
|
||||
.minimum_version_id = 1,
|
||||
.fields = (VMStateField[]) {
|
||||
|
||||
VMSTATE_UINTTL_ARRAY(env.gpr, LoongArchCPU, 32),
|
||||
VMSTATE_UINTTL(env.pc, LoongArchCPU),
|
||||
VMSTATE_UINT64_ARRAY(env.fpr, LoongArchCPU, 32),
|
||||
VMSTATE_UINT32(env.fcsr0, LoongArchCPU),
|
||||
VMSTATE_BOOL_ARRAY(env.cf, LoongArchCPU, 8),
|
||||
|
||||
/* Remaining CSRs */
|
||||
VMSTATE_UINT64(env.CSR_CRMD, LoongArchCPU),
|
||||
@@ -99,4 +160,8 @@ const VMStateDescription vmstate_loongarch_cpu = {
|
||||
|
||||
VMSTATE_END_OF_LIST()
|
||||
},
|
||||
.subsections = (const VMStateDescription*[]) {
|
||||
&vmstate_fpu,
|
||||
&vmstate_lsx,
|
||||
}
|
||||
};
|
||||
|
||||
@@ -11,6 +11,7 @@ loongarch_tcg_ss.add(files(
|
||||
'op_helper.c',
|
||||
'translate.c',
|
||||
'gdbstub.c',
|
||||
'lsx_helper.c',
|
||||
))
|
||||
loongarch_tcg_ss.add(zlib)
|
||||
|
||||
|
||||
@@ -8,6 +8,8 @@
|
||||
#include "qemu/osdep.h"
|
||||
#include "cpu.h"
|
||||
#include "tcg/tcg-op.h"
|
||||
#include "tcg/tcg-op-gvec.h"
|
||||
|
||||
#include "exec/translator.h"
|
||||
#include "exec/helper-proto.h"
|
||||
#include "exec/helper-gen.h"
|
||||
@@ -21,7 +23,6 @@
|
||||
/* Global register indices */
|
||||
TCGv cpu_gpr[32], cpu_pc;
|
||||
static TCGv cpu_lladdr, cpu_llval;
|
||||
TCGv_i64 cpu_fpr[32];
|
||||
|
||||
#include "exec/gen-icount.h"
|
||||
|
||||
@@ -29,16 +30,43 @@ TCGv_i64 cpu_fpr[32];
|
||||
#define DISAS_EXIT DISAS_TARGET_1
|
||||
#define DISAS_EXIT_UPDATE DISAS_TARGET_2
|
||||
|
||||
static inline int vec_full_offset(int regno)
|
||||
{
|
||||
return offsetof(CPULoongArchState, fpr[regno]);
|
||||
}
|
||||
|
||||
static inline void get_vreg64(TCGv_i64 dest, int regno, int index)
|
||||
{
|
||||
tcg_gen_ld_i64(dest, cpu_env,
|
||||
offsetof(CPULoongArchState, fpr[regno].vreg.D(index)));
|
||||
}
|
||||
|
||||
static inline void set_vreg64(TCGv_i64 src, int regno, int index)
|
||||
{
|
||||
tcg_gen_st_i64(src, cpu_env,
|
||||
offsetof(CPULoongArchState, fpr[regno].vreg.D(index)));
|
||||
}
|
||||
|
||||
static inline int plus_1(DisasContext *ctx, int x)
|
||||
{
|
||||
return x + 1;
|
||||
}
|
||||
|
||||
static inline int shl_1(DisasContext *ctx, int x)
|
||||
{
|
||||
return x << 1;
|
||||
}
|
||||
|
||||
static inline int shl_2(DisasContext *ctx, int x)
|
||||
{
|
||||
return x << 2;
|
||||
}
|
||||
|
||||
static inline int shl_3(DisasContext *ctx, int x)
|
||||
{
|
||||
return x << 3;
|
||||
}
|
||||
|
||||
/*
|
||||
* LoongArch the upper 32 bits are undefined ("can be any value").
|
||||
* QEMU chooses to nanbox, because it is most likely to show guest bugs early.
|
||||
@@ -71,6 +99,7 @@ static void loongarch_tr_init_disas_context(DisasContextBase *dcbase,
|
||||
CPUState *cs)
|
||||
{
|
||||
int64_t bound;
|
||||
CPULoongArchState *env = cs->env_ptr;
|
||||
DisasContext *ctx = container_of(dcbase, DisasContext, base);
|
||||
|
||||
ctx->page_start = ctx->base.pc_first & TARGET_PAGE_MASK;
|
||||
@@ -85,6 +114,10 @@ static void loongarch_tr_init_disas_context(DisasContextBase *dcbase,
|
||||
bound = -(ctx->base.pc_first | TARGET_PAGE_MASK) / 4;
|
||||
ctx->base.max_insns = MIN(ctx->base.max_insns, bound);
|
||||
|
||||
if (FIELD_EX64(env->cpucfg[2], CPUCFG2, LSX)) {
|
||||
ctx->vl = LSX_LEN;
|
||||
}
|
||||
|
||||
ctx->zero = tcg_constant_tl(0);
|
||||
}
|
||||
|
||||
@@ -157,6 +190,20 @@ static void gen_set_gpr(int reg_num, TCGv t, DisasExtend dst_ext)
|
||||
}
|
||||
}
|
||||
|
||||
static TCGv get_fpr(DisasContext *ctx, int reg_num)
|
||||
{
|
||||
TCGv t = tcg_temp_new();
|
||||
tcg_gen_ld_i64(t, cpu_env,
|
||||
offsetof(CPULoongArchState, fpr[reg_num].vreg.D(0)));
|
||||
return t;
|
||||
}
|
||||
|
||||
static void set_fpr(int reg_num, TCGv val)
|
||||
{
|
||||
tcg_gen_st_i64(val, cpu_env,
|
||||
offsetof(CPULoongArchState, fpr[reg_num].vreg.D(0)));
|
||||
}
|
||||
|
||||
#include "decode-insns.c.inc"
|
||||
#include "insn_trans/trans_arith.c.inc"
|
||||
#include "insn_trans/trans_shift.c.inc"
|
||||
@@ -171,6 +218,7 @@ static void gen_set_gpr(int reg_num, TCGv t, DisasExtend dst_ext)
|
||||
#include "insn_trans/trans_fmemory.c.inc"
|
||||
#include "insn_trans/trans_branch.c.inc"
|
||||
#include "insn_trans/trans_privileged.c.inc"
|
||||
#include "insn_trans/trans_lsx.c.inc"
|
||||
|
||||
static void loongarch_tr_translate_insn(DisasContextBase *dcbase, CPUState *cs)
|
||||
{
|
||||
@@ -250,11 +298,6 @@ void loongarch_translate_init(void)
|
||||
regnames[i]);
|
||||
}
|
||||
|
||||
for (i = 0; i < 32; i++) {
|
||||
int off = offsetof(CPULoongArchState, fpr[i]);
|
||||
cpu_fpr[i] = tcg_global_mem_new_i64(cpu_env, off, fregnames[i]);
|
||||
}
|
||||
|
||||
cpu_pc = tcg_global_mem_new(cpu_env, offsetof(CPULoongArchState, pc), "pc");
|
||||
cpu_lladdr = tcg_global_mem_new(cpu_env,
|
||||
offsetof(CPULoongArchState, lladdr), "lladdr");
|
||||
|
||||
@@ -31,6 +31,7 @@ typedef struct DisasContext {
|
||||
uint32_t opcode;
|
||||
uint16_t mem_idx;
|
||||
uint16_t plv;
|
||||
int vl; /* Vector length */
|
||||
TCGv zero;
|
||||
} DisasContext;
|
||||
|
||||
|
||||
Reference in New Issue
Block a user