[AMDGPU] gfx1031 target

author Stanislav Mekhanoshin <Stanislav.Mekhanoshin@amd.com>

Wed, 5 Aug 2020 19:00:52 +0000 (12:00 -0700)

committer Stanislav Mekhanoshin <Stanislav.Mekhanoshin@amd.com>

Wed, 5 Aug 2020 19:36:26 +0000 (12:36 -0700)
author Stanislav Mekhanoshin <Stanislav.Mekhanoshin@amd.com>
Wed, 5 Aug 2020 19:00:52 +0000 (12:00 -0700)
committer Stanislav Mekhanoshin <Stanislav.Mekhanoshin@amd.com>
Wed, 5 Aug 2020 19:36:26 +0000 (12:36 -0700)
diff --git a/clang/include/clang/Basic/Cuda.h b/clang/include/clang/Basic/Cuda.h

index 1716325..19301e8 100644 (file)
--- a/clang/include/clang/Basic/Cuda.h
+++ b/clang/include/clang/Basic/Cuda.h
@@ -75,6 +75,7 @@ enum class CudaArch {
    GFX1011,
    GFX1012,
    GFX1030,
+  GFX1031,
    LAST,
  };
  
diff --git a/clang/lib/Basic/Targets/AMDGPU.cpp b/clang/lib/Basic/Targets/AMDGPU.cpp

index e147045..57351c7 100644 (file)
--- a/clang/lib/Basic/Targets/AMDGPU.cpp
+++ b/clang/lib/Basic/Targets/AMDGPU.cpp
@@ -174,6 +174,7 @@ bool AMDGPUTargetInfo::initFeatureMap(
    // XXX - What does the member GPU mean if device name string passed here?
    if (isAMDGCN(getTriple())) {
      switch (llvm::AMDGPU::parseArchAMDGCN(CPU)) {
+    case GK_GFX1031:
      case GK_GFX1030:
        Features["ci-insts"] = true;
        Features["dot1-insts"] = true;
diff --git a/clang/lib/Basic/Targets/NVPTX.cpp b/clang/lib/Basic/Targets/NVPTX.cpp

index 18c3c83..ef61b8f 100644 (file)
--- a/clang/lib/Basic/Targets/NVPTX.cpp
+++ b/clang/lib/Basic/Targets/NVPTX.cpp
@@ -201,6 +201,7 @@ void NVPTXTargetInfo::getTargetDefines(const LangOptions &Opts,
        case CudaArch::GFX1011:
        case CudaArch::GFX1012:
        case CudaArch::GFX1030:
+      case CudaArch::GFX1031:
        case CudaArch::LAST:
          break;
        case CudaArch::UNKNOWN:
diff --git a/clang/test/CodeGenOpenCL/amdgpu-features.cl b/clang/test/CodeGenOpenCL/amdgpu-features.cl

index 4c26163..93357a4 100644 (file)
--- a/clang/test/CodeGenOpenCL/amdgpu-features.cl
+++ b/clang/test/CodeGenOpenCL/amdgpu-features.cl
@@ -14,6 +14,7 @@
  // RUN: %clang_cc1 -triple amdgcn -target-cpu gfx1011 -S -emit-llvm -o - %s | FileCheck --check-prefix=GFX1011 %s
  // RUN: %clang_cc1 -triple amdgcn -target-cpu gfx1012 -S -emit-llvm -o - %s | FileCheck --check-prefix=GFX1012 %s
  // RUN: %clang_cc1 -triple amdgcn -target-cpu gfx1030 -S -emit-llvm -o - %s | FileCheck --check-prefix=GFX1030 %s
+// RUN: %clang_cc1 -triple amdgcn -target-cpu gfx1031 -S -emit-llvm -o - %s | FileCheck --check-prefix=GFX1031 %s
  
  // GFX600-NOT: "target-features"
  // GFX601-NOT: "target-features"
@@ -26,5 +27,6 @@
  // GFX1011: "target-features"="+16-bit-insts,+ci-insts,+dl-insts,+dot1-insts,+dot2-insts,+dot5-insts,+dot6-insts,+dpp,+flat-address-space,+gfx10-insts,+gfx8-insts,+gfx9-insts,+s-memrealtime"
  // GFX1012: "target-features"="+16-bit-insts,+ci-insts,+dl-insts,+dot1-insts,+dot2-insts,+dot5-insts,+dot6-insts,+dpp,+flat-address-space,+gfx10-insts,+gfx8-insts,+gfx9-insts,+s-memrealtime"
  // GFX1030: "target-features"="+16-bit-insts,+ci-insts,+dl-insts,+dot1-insts,+dot2-insts,+dot5-insts,+dot6-insts,+dpp,+flat-address-space,+gfx10-3-insts,+gfx10-insts,+gfx8-insts,+gfx9-insts,+s-memrealtime"
+// GFX1031: "target-features"="+16-bit-insts,+ci-insts,+dl-insts,+dot1-insts,+dot2-insts,+dot5-insts,+dot6-insts,+dpp,+flat-address-space,+gfx10-3-insts,+gfx10-insts,+gfx8-insts,+gfx9-insts,+s-memrealtime"
  
  kernel void test() {}
diff --git a/clang/test/Driver/amdgpu-macros.cl b/clang/test/Driver/amdgpu-macros.cl

index 24d2fea..ae46e85 100644 (file)
--- a/clang/test/Driver/amdgpu-macros.cl
+++ b/clang/test/Driver/amdgpu-macros.cl
@@ -181,6 +181,7 @@
  // RUN: %clang -E -dM -target amdgcn -mcpu=gfx1011 %s 2>&1 | FileCheck --check-prefixes=ARCH-GCN,GFX1011 %s
  // RUN: %clang -E -dM -target amdgcn -mcpu=gfx1012 %s 2>&1 | FileCheck --check-prefixes=ARCH-GCN,GFX1012 %s
  // RUN: %clang -E -dM -target amdgcn -mcpu=gfx1030 %s 2>&1 | FileCheck --check-prefixes=ARCH-GCN,GFX1030 %s
+// RUN: %clang -E -dM -target amdgcn -mcpu=gfx1031 %s 2>&1 | FileCheck --check-prefixes=ARCH-GCN,GFX1031 %s
  
  // GFX600-DAG: #define FP_FAST_FMA 1
  // GFX601-DAG: #define FP_FAST_FMA 1
@@ -203,6 +204,7 @@
  // GFX1011-DAG: #define FP_FAST_FMA 1
  // GFX1012-DAG: #define FP_FAST_FMA 1
  // GFX1030-DAG: #define FP_FAST_FMA 1
+// GFX1031-DAG: #define FP_FAST_FMA 1
  
  // GFX600-DAG: #define FP_FAST_FMAF 1
  // GFX601-NOT: #define FP_FAST_FMAF 1
@@ -225,6 +227,7 @@
  // GFX1011-DAG: #define FP_FAST_FMAF 1
  // GFX1012-DAG: #define FP_FAST_FMAF 1
  // GFX1030-DAG: #define FP_FAST_FMAF 1
+// GFX1031-DAG: #define FP_FAST_FMAF 1
  
  // ARCH-GCN-DAG: #define __AMDGCN__ 1
  // ARCH-GCN-DAG: #define __AMDGPU__ 1
@@ -251,6 +254,7 @@
  // GFX1011-DAG: #define __HAS_FMAF__ 1
  // GFX1012-DAG: #define __HAS_FMAF__ 1
  // GFX1030-DAG: #define __HAS_FMAF__ 1
+// GFX1031-DAG: #define __HAS_FMAF__ 1
  
  // GFX600-DAG: #define __HAS_FP64__ 1
  // GFX601-DAG: #define __HAS_FP64__ 1
@@ -273,6 +277,7 @@
  // GFX1011-DAG: #define __HAS_FP64__ 1
  // GFX1012-DAG: #define __HAS_FP64__ 1
  // GFX1030-DAG: #define __HAS_FP64__ 1
+// GFX1031-DAG: #define __HAS_FP64__ 1
  
  // GFX600-DAG: #define __HAS_LDEXPF__ 1
  // GFX601-DAG: #define __HAS_LDEXPF__ 1
@@ -295,6 +300,7 @@
  // GFX1011-DAG: #define __HAS_LDEXPF__ 1
  // GFX1012-DAG: #define __HAS_LDEXPF__ 1
  // GFX1030-DAG: #define __HAS_LDEXPF__ 1
+// GFX1031-DAG: #define __HAS_LDEXPF__ 1
  
  // GFX600-DAG: #define __gfx600__ 1
  // GFX601-DAG: #define __gfx601__ 1
@@ -317,3 +323,4 @@
  // GFX1011-DAG: #define __gfx1011__ 1
  // GFX1012-DAG: #define __gfx1012__ 1
  // GFX1030-DAG: #define __gfx1030__ 1
+// GFX1031-DAG: #define __gfx1031__ 1
diff --git a/clang/test/Driver/amdgpu-mcpu.cl b/clang/test/Driver/amdgpu-mcpu.cl

index cc08fef..041e3fc 100644 (file)
--- a/clang/test/Driver/amdgpu-mcpu.cl
+++ b/clang/test/Driver/amdgpu-mcpu.cl
@@ -91,6 +91,7 @@
  // RUN: %clang -### -target amdgcn -mcpu=gfx1011 %s 2>&1 | FileCheck --check-prefix=GFX1011 %s
  // RUN: %clang -### -target amdgcn -mcpu=gfx1012 %s 2>&1 | FileCheck --check-prefix=GFX1012 %s
  // RUN: %clang -### -target amdgcn -mcpu=gfx1030 %s 2>&1 | FileCheck --check-prefix=GFX1030 %s
+// RUN: %clang -### -target amdgcn -mcpu=gfx1031 %s 2>&1 | FileCheck --check-prefix=GFX1031 %s
  
  // GCNDEFAULT-NOT: -target-cpu
  // GFX600:    "-target-cpu" "gfx600"
@@ -131,3 +132,4 @@
  // GFX1011:   "-target-cpu" "gfx1011"
  // GFX1012:   "-target-cpu" "gfx1012"
  // GFX1030:   "-target-cpu" "gfx1030"
+// GFX1031:   "-target-cpu" "gfx1031"
diff --git a/llvm/docs/AMDGPUUsage.rst b/llvm/docs/AMDGPUUsage.rst

index 0a29f9e..62e9935 100644 (file)
--- a/llvm/docs/AMDGPUUsage.rst
+++ b/llvm/docs/AMDGPUUsage.rst
@@ -266,6 +266,15 @@ names from both the *Processor* and *Alternative Processor* can be used.
                                                                                .. TODO
                                                                                   Add product
                                                                                   names.
+     ``gfx1031``                 ``amdgcn``   dGPU  - xnack                   *TBA*
+                                                      [off]
+                                                    - wavefrontsize64
+                                                      [off]
+                                                    - cumode
+                                                      [off]
+                                                                              .. TODO
+                                                                                 Add product
+                                                                                 names.
       =========== =============== ============ ===== ================= ======= ======================
  
  .. _amdgpu-target-features:
@@ -810,6 +819,7 @@ The AMDGPU backend uses the following ELF header:
       ``EF_AMDGPU_MACH_AMDGCN_GFX1011`` 0x034      ``gfx1011``
       ``EF_AMDGPU_MACH_AMDGCN_GFX1012`` 0x035      ``gfx1012``
       ``EF_AMDGPU_MACH_AMDGCN_GFX1030`` 0x036      ``gfx1030``
+     ``EF_AMDGPU_MACH_AMDGCN_GFX1031`` 0x037      ``gfx1031``
       ================================= ========== =============================
  
  Sections
diff --git a/llvm/include/llvm/BinaryFormat/ELF.h b/llvm/include/llvm/BinaryFormat/ELF.h

index bdcf10f..a1eb4d0 100644 (file)
--- a/llvm/include/llvm/BinaryFormat/ELF.h
+++ b/llvm/include/llvm/BinaryFormat/ELF.h
@@ -707,6 +707,7 @@ enum : unsigned {
    EF_AMDGPU_MACH_AMDGCN_GFX1011 = 0x034,
    EF_AMDGPU_MACH_AMDGCN_GFX1012 = 0x035,
    EF_AMDGPU_MACH_AMDGCN_GFX1030 = 0x036,
+  EF_AMDGPU_MACH_AMDGCN_GFX1031 = 0x037,
  
    // Reserved for AMDGCN-based processors.
    EF_AMDGPU_MACH_AMDGCN_RESERVED0 = 0x027,
@@ -714,7 +715,7 @@ enum : unsigned {
  
    // First/last AMDGCN-based processors.
    EF_AMDGPU_MACH_AMDGCN_FIRST = EF_AMDGPU_MACH_AMDGCN_GFX600,
-  EF_AMDGPU_MACH_AMDGCN_LAST = EF_AMDGPU_MACH_AMDGCN_GFX1030,
+  EF_AMDGPU_MACH_AMDGCN_LAST = EF_AMDGPU_MACH_AMDGCN_GFX1031,
  
    // Indicates if the "xnack" target feature is enabled for all code contained
    // in the object.
diff --git a/llvm/include/llvm/Support/TargetParser.h b/llvm/include/llvm/Support/TargetParser.h

index f521d8f..f909729 100644 (file)
--- a/llvm/include/llvm/Support/TargetParser.h
+++ b/llvm/include/llvm/Support/TargetParser.h
@@ -85,9 +85,10 @@ enum GPUKind : uint32_t {
    GK_GFX1011 = 72,
    GK_GFX1012 = 73,
    GK_GFX1030 = 75,
+  GK_GFX1031 = 76,
  
    GK_AMDGCN_FIRST = GK_GFX600,
-  GK_AMDGCN_LAST = GK_GFX1030,
+  GK_AMDGCN_LAST = GK_GFX1031,
  };
  
  /// Instruction set architecture version.
diff --git a/llvm/lib/ObjectYAML/ELFYAML.cpp b/llvm/lib/ObjectYAML/ELFYAML.cpp

index f460a38..319e370 100644 (file)
--- a/llvm/lib/ObjectYAML/ELFYAML.cpp
+++ b/llvm/lib/ObjectYAML/ELFYAML.cpp
@@ -430,6 +430,7 @@ void ScalarBitSetTraits<ELFYAML::ELF_EF>::bitset(IO &IO,
      BCaseMask(EF_AMDGPU_MACH_AMDGCN_GFX1011, EF_AMDGPU_MACH);
      BCaseMask(EF_AMDGPU_MACH_AMDGCN_GFX1012, EF_AMDGPU_MACH);
      BCaseMask(EF_AMDGPU_MACH_AMDGCN_GFX1030, EF_AMDGPU_MACH);
+    BCaseMask(EF_AMDGPU_MACH_AMDGCN_GFX1031, EF_AMDGPU_MACH);
      BCase(EF_AMDGPU_XNACK);
      BCase(EF_AMDGPU_SRAM_ECC);
      break;
diff --git a/llvm/lib/Support/TargetParser.cpp b/llvm/lib/Support/TargetParser.cpp

index 031384e..7adfd80 100644 (file)
--- a/llvm/lib/Support/TargetParser.cpp
+++ b/llvm/lib/Support/TargetParser.cpp
@@ -63,7 +63,7 @@ constexpr GPUInfo R600GPUs[26] = {
  
  // This table should be sorted by the value of GPUKind
  // Don't bother listing the implicitly true features
-constexpr GPUInfo AMDGCNGPUs[38] = {
+constexpr GPUInfo AMDGCNGPUs[39] = {
    // Name         Canonical    Kind        Features
    //              Name
    {{"gfx600"},    {"gfx600"},  GK_GFX600,  FEATURE_FAST_FMA_F32},
@@ -104,6 +104,7 @@ constexpr GPUInfo AMDGCNGPUs[38] = {
    {{"gfx1011"},   {"gfx1011"}, GK_GFX1011, FEATURE_FAST_FMA_F32|FEATURE_FAST_DENORMAL_F32|FEATURE_WAVE32},
    {{"gfx1012"},   {"gfx1012"}, GK_GFX1012, FEATURE_FAST_FMA_F32|FEATURE_FAST_DENORMAL_F32|FEATURE_WAVE32},
    {{"gfx1030"},   {"gfx1030"}, GK_GFX1030, FEATURE_FAST_FMA_F32|FEATURE_FAST_DENORMAL_F32|FEATURE_WAVE32},
+  {{"gfx1031"},   {"gfx1031"}, GK_GFX1031, FEATURE_FAST_FMA_F32|FEATURE_FAST_DENORMAL_F32|FEATURE_WAVE32},
  };
  
  const GPUInfo *getArchEntry(AMDGPU::GPUKind AK, ArrayRef<GPUInfo> Table) {
@@ -206,6 +207,7 @@ AMDGPU::IsaVersion AMDGPU::getIsaVersion(StringRef GPU) {
    case GK_GFX1011: return {10, 1, 1};
    case GK_GFX1012: return {10, 1, 2};
    case GK_GFX1030: return {10, 3, 0};
+  case GK_GFX1031: return {10, 3, 1};
    default:         return {0, 0, 0};
    }
  }
diff --git a/llvm/lib/Target/AMDGPU/GCNProcessors.td b/llvm/lib/Target/AMDGPU/GCNProcessors.td

index 17e6098..8b0132a 100644 (file)
--- a/llvm/lib/Target/AMDGPU/GCNProcessors.td
+++ b/llvm/lib/Target/AMDGPU/GCNProcessors.td
@@ -187,3 +187,7 @@ def : ProcessorModel<"gfx1012", GFX10SpeedModel,
  def : ProcessorModel<"gfx1030", GFX10SpeedModel,
    FeatureISAVersion10_3_0.Features
  >;
+
+def : ProcessorModel<"gfx1031", GFX10SpeedModel,
+  FeatureISAVersion10_3_0.Features
+>;
diff --git a/llvm/lib/Target/AMDGPU/MCTargetDesc/AMDGPUTargetStreamer.cpp b/llvm/lib/Target/AMDGPU/MCTargetDesc/AMDGPUTargetStreamer.cpp

index 3d202d7..d040efe 100644 (file)
--- a/llvm/lib/Target/AMDGPU/MCTargetDesc/AMDGPUTargetStreamer.cpp
+++ b/llvm/lib/Target/AMDGPU/MCTargetDesc/AMDGPUTargetStreamer.cpp
@@ -98,6 +98,7 @@ StringRef AMDGPUTargetStreamer::getArchNameFromElfMach(unsigned ElfMach) {
    case ELF::EF_AMDGPU_MACH_AMDGCN_GFX1011: AK = GK_GFX1011; break;
    case ELF::EF_AMDGPU_MACH_AMDGCN_GFX1012: AK = GK_GFX1012; break;
    case ELF::EF_AMDGPU_MACH_AMDGCN_GFX1030: AK = GK_GFX1030; break;
+  case ELF::EF_AMDGPU_MACH_AMDGCN_GFX1031: AK = GK_GFX1031; break;
    case ELF::EF_AMDGPU_MACH_NONE:           AK = GK_NONE;    break;
    }
  
@@ -150,6 +151,7 @@ unsigned AMDGPUTargetStreamer::getElfMach(StringRef GPU) {
    case GK_GFX1011: return ELF::EF_AMDGPU_MACH_AMDGCN_GFX1011;
    case GK_GFX1012: return ELF::EF_AMDGPU_MACH_AMDGCN_GFX1012;
    case GK_GFX1030: return ELF::EF_AMDGPU_MACH_AMDGCN_GFX1030;
+  case GK_GFX1031: return ELF::EF_AMDGPU_MACH_AMDGCN_GFX1031;
    case GK_NONE:    return ELF::EF_AMDGPU_MACH_NONE;
    }
  
diff --git a/llvm/test/CodeGen/AMDGPU/GlobalISel/legalize-fmad.s32.mir b/llvm/test/CodeGen/AMDGPU/GlobalISel/legalize-fmad.s32.mir

index 4a72033..97cc62e 100644 (file)
--- a/llvm/test/CodeGen/AMDGPU/GlobalISel/legalize-fmad.s32.mir
+++ b/llvm/test/CodeGen/AMDGPU/GlobalISel/legalize-fmad.s32.mir
@@ -3,6 +3,7 @@
  # RUN: llc -mtriple=amdgcn-mesa-mesa3d -mcpu=fiji -run-pass=legalizer %s -o - | FileCheck -check-prefix=GFX7 %s
  # RUN: llc -mtriple=amdgcn-mesa-mesa3d -mcpu=gfx1010 -run-pass=legalizer %s -o - | FileCheck -check-prefix=GFX101 %s
  # RUN: llc -mtriple=amdgcn-mesa-mesa3d -mcpu=gfx1030 -run-pass=legalizer %s -o - | FileCheck -check-prefix=GFX103 %s
+# RUN: llc -mtriple=amdgcn-mesa-mesa3d -mcpu=gfx1031 -run-pass=legalizer %s -o - | FileCheck -check-prefix=GFX103 %s
  
  ---
  name: test_fmad_s32_flush
diff --git a/llvm/test/CodeGen/AMDGPU/GlobalISel/llvm.amdgcn.global.atomic.csub.ll b/llvm/test/CodeGen/AMDGPU/GlobalISel/llvm.amdgcn.global.atomic.csub.ll

index 9bc56d1..8eee8a8 100644 (file)
--- a/llvm/test/CodeGen/AMDGPU/GlobalISel/llvm.amdgcn.global.atomic.csub.ll
+++ b/llvm/test/CodeGen/AMDGPU/GlobalISel/llvm.amdgcn.global.atomic.csub.ll
@@ -1,5 +1,6 @@
  ; NOTE: Assertions have been autogenerated by utils/update_llc_test_checks.py
  ; RUN: llc -global-isel -mtriple=amdgcn-amd-amdhsa -mcpu=gfx1030 -verify-machineinstrs < %s | FileCheck %s -check-prefix=GCN
+; RUN: llc -global-isel -mtriple=amdgcn-amd-amdhsa -mcpu=gfx1031 -verify-machineinstrs < %s | FileCheck %s -check-prefix=GCN
  
  define i32 @global_atomic_csub(i32 addrspace(1)* %ptr, i32 %data) {
  ; GCN-LABEL: global_atomic_csub:
diff --git a/llvm/test/CodeGen/AMDGPU/elf-header-flags-mach.ll b/llvm/test/CodeGen/AMDGPU/elf-header-flags-mach.ll

index 8679e4e..15c8ca8 100644 (file)
--- a/llvm/test/CodeGen/AMDGPU/elf-header-flags-mach.ll
+++ b/llvm/test/CodeGen/AMDGPU/elf-header-flags-mach.ll
@@ -52,6 +52,7 @@
  ; RUN: llc -filetype=obj -march=amdgcn -mcpu=gfx1011 < %s | llvm-readobj -file-headers - | FileCheck --check-prefixes=ALL,ARCH-GCN,GFX1011 %s
  ; RUN: llc -filetype=obj -march=amdgcn -mcpu=gfx1012 < %s | llvm-readobj -file-headers - | FileCheck --check-prefixes=ALL,ARCH-GCN,GFX1012 %s
  ; RUN: llc -filetype=obj -march=amdgcn -mcpu=gfx1030 < %s | llvm-readobj -file-headers - | FileCheck --check-prefixes=ALL,ARCH-GCN,GFX1030 %s
+; RUN: llc -filetype=obj -march=amdgcn -mcpu=gfx1031 < %s | llvm-readobj -file-headers - | FileCheck --check-prefixes=ALL,ARCH-GCN,GFX1031 %s
  
  ; ARCH-R600: Arch: r600
  ; ARCH-GCN:  Arch: amdgcn
@@ -98,6 +99,7 @@
  ; GFX1011:       EF_AMDGPU_MACH_AMDGCN_GFX1011 (0x34)
  ; GFX1012:       EF_AMDGPU_MACH_AMDGCN_GFX1012 (0x35)
  ; GFX1030:       EF_AMDGPU_MACH_AMDGCN_GFX1030 (0x36)
+; GFX1031:       EF_AMDGPU_MACH_AMDGCN_GFX1031 (0x37)
  ; ALL:         ]
  
  define amdgpu_kernel void @elf_header() {
diff --git a/llvm/test/CodeGen/AMDGPU/hsa-note-no-func.ll b/llvm/test/CodeGen/AMDGPU/hsa-note-no-func.ll

index 6b4c730..0711806 100644 (file)
--- a/llvm/test/CodeGen/AMDGPU/hsa-note-no-func.ll
+++ b/llvm/test/CodeGen/AMDGPU/hsa-note-no-func.ll
@@ -29,6 +29,7 @@
  ; RUN: llc < %s -mtriple=amdgcn--amdhsa -mcpu=gfx1011 -mattr=-code-object-v3 | FileCheck --check-prefix=HSA --check-prefix=HSA-GFX1011 %s
  ; RUN: llc < %s -mtriple=amdgcn--amdhsa -mcpu=gfx1012 -mattr=-code-object-v3 | FileCheck --check-prefix=HSA --check-prefix=HSA-GFX1012 %s
  ; RUN: llc < %s -mtriple=amdgcn--amdhsa -mcpu=gfx1030 -mattr=-code-object-v3 | FileCheck --check-prefix=HSA --check-prefix=HSA-GFX1030 %s
+; RUN: llc < %s -mtriple=amdgcn--amdhsa -mcpu=gfx1031 -mattr=-code-object-v3 | FileCheck --check-prefix=HSA --check-prefix=HSA-GFX1031 %s
  
  ; HSA: .hsa_code_object_version 2,1
  ; HSA-SI600: .hsa_code_object_isa 6,0,0,"AMD","AMDGPU"
@@ -52,3 +53,4 @@
  ; HSA-GFX1011: .hsa_code_object_isa 10,1,1,"AMD","AMDGPU"
  ; HSA-GFX1012: .hsa_code_object_isa 10,1,2,"AMD","AMDGPU"
  ; HSA-GFX1030: .hsa_code_object_isa 10,3,0,"AMD","AMDGPU"
+; HSA-GFX1031: .hsa_code_object_isa 10,3,1,"AMD","AMDGPU"
diff --git a/llvm/test/CodeGen/AMDGPU/idot8s.ll b/llvm/test/CodeGen/AMDGPU/idot8s.ll

index e7d48de..fbc602b 100644 (file)
--- a/llvm/test/CodeGen/AMDGPU/idot8s.ll
+++ b/llvm/test/CodeGen/AMDGPU/idot8s.ll
@@ -6,6 +6,7 @@
  ; RUN: llc -mtriple=amdgcn -mcpu=gfx1011 -verify-machineinstrs < %s | FileCheck -check-prefixes=GFX10-DL %s
  ; RUN: llc -mtriple=amdgcn -mcpu=gfx1012 -verify-machineinstrs < %s | FileCheck -check-prefixes=GFX10-DL %s
  ; RUN: llc -mtriple=amdgcn -mcpu=gfx1030 -verify-machineinstrs < %s | FileCheck -check-prefixes=GFX10-DL %s
+; RUN: llc -mtriple=amdgcn -mcpu=gfx1031 -verify-machineinstrs < %s | FileCheck -check-prefixes=GFX10-DL %s
  
  define amdgpu_kernel void @idot8_acc32(<8 x i4> addrspace(1)* %src1,
  ; GFX7-LABEL: idot8_acc32:
diff --git a/llvm/test/CodeGen/AMDGPU/llvm.amdgcn.atomic.csub.ll b/llvm/test/CodeGen/AMDGPU/llvm.amdgcn.atomic.csub.ll

index e3fd229..4ab8c34 100644 (file)
--- a/llvm/test/CodeGen/AMDGPU/llvm.amdgcn.atomic.csub.ll
+++ b/llvm/test/CodeGen/AMDGPU/llvm.amdgcn.atomic.csub.ll
@@ -1,4 +1,5 @@
  ; RUN: llc < %s -march=amdgcn -mcpu=gfx1030 -verify-machineinstrs | FileCheck %s -check-prefix=GCN
+; RUN: llc < %s -march=amdgcn -mcpu=gfx1031 -verify-machineinstrs | FileCheck %s -check-prefix=GCN
  
  declare i32 @llvm.amdgcn.buffer.atomic.csub(i32, <4 x i32>, i32, i32, i1)
  declare i32 @llvm.amdgcn.global.atomic.csub(i32 addrspace(1)*, i32)
diff --git a/llvm/test/CodeGen/AMDGPU/llvm.amdgcn.sdot4.ll b/llvm/test/CodeGen/AMDGPU/llvm.amdgcn.sdot4.ll

index 0fa11c4..4166101 100644 (file)
--- a/llvm/test/CodeGen/AMDGPU/llvm.amdgcn.sdot4.ll
+++ b/llvm/test/CodeGen/AMDGPU/llvm.amdgcn.sdot4.ll
@@ -2,6 +2,7 @@
  ; RUN: llc -march=amdgcn -mcpu=gfx1011 -verify-machineinstrs < %s | FileCheck %s --check-prefixes=GCN,GFX10
  ; RUN: llc -march=amdgcn -mcpu=gfx1012 -verify-machineinstrs < %s | FileCheck %s --check-prefixes=GCN,GFX10
  ; RUN: llc -march=amdgcn -mcpu=gfx1030 -verify-machineinstrs < %s | FileCheck %s --check-prefixes=GCN,GFX10
+; RUN: llc -march=amdgcn -mcpu=gfx1031 -verify-machineinstrs < %s | FileCheck %s --check-prefixes=GCN,GFX10
  
  declare i32 @llvm.amdgcn.sdot4(i32 %a, i32 %b, i32 %c, i1 %clamp)
  
diff --git a/llvm/test/CodeGen/AMDGPU/llvm.amdgcn.sdot8.ll b/llvm/test/CodeGen/AMDGPU/llvm.amdgcn.sdot8.ll

index 3d87ad0..948bc53 100644 (file)
--- a/llvm/test/CodeGen/AMDGPU/llvm.amdgcn.sdot8.ll
+++ b/llvm/test/CodeGen/AMDGPU/llvm.amdgcn.sdot8.ll
@@ -3,6 +3,7 @@
  ; RUN: llc -march=amdgcn -mcpu=gfx1011 -verify-machineinstrs < %s | FileCheck %s --check-prefixes=GCN,GFX10
  ; RUN: llc -march=amdgcn -mcpu=gfx1012 -verify-machineinstrs < %s | FileCheck %s --check-prefixes=GCN,GFX10
  ; RUN: llc -march=amdgcn -mcpu=gfx1030 -verify-machineinstrs < %s | FileCheck %s --check-prefixes=GCN,GFX10
+; RUN: llc -march=amdgcn -mcpu=gfx1031 -verify-machineinstrs < %s | FileCheck %s --check-prefixes=GCN,GFX10
  
  declare i32 @llvm.amdgcn.sdot8(i32 %a, i32 %b, i32 %c, i1 %clamp)
  
diff --git a/llvm/test/MC/AMDGPU/gfx1030_err.s b/llvm/test/MC/AMDGPU/gfx1030_err.s

index 804e4b8..29d906e 100644 (file)
--- a/llvm/test/MC/AMDGPU/gfx1030_err.s
+++ b/llvm/test/MC/AMDGPU/gfx1030_err.s
@@ -1,4 +1,5 @@
  // RUN: not llvm-mc -arch=amdgcn -mcpu=gfx1030 -show-encoding %s 2>&1 | FileCheck --check-prefix=GFX10 %s
+// RUN: not llvm-mc -arch=amdgcn -mcpu=gfx1031 -show-encoding %s 2>&1 | FileCheck --check-prefix=GFX10 %s
  
  v_dot8c_i32_i4 v5, v1, v2
  // GFX10: error:
diff --git a/llvm/test/MC/AMDGPU/gfx1030_new.s b/llvm/test/MC/AMDGPU/gfx1030_new.s

index 5f6aea8..7125fd2 100644 (file)
--- a/llvm/test/MC/AMDGPU/gfx1030_new.s
+++ b/llvm/test/MC/AMDGPU/gfx1030_new.s
@@ -1,4 +1,5 @@
  // RUN: llvm-mc -arch=amdgcn -mcpu=gfx1030 -show-encoding %s | FileCheck --check-prefix=GFX10 %s
+// RUN: llvm-mc -arch=amdgcn -mcpu=gfx1031 -show-encoding %s | FileCheck --check-prefix=GFX10 %s
  
  global_load_dword_addtid v1, s[2:3] offset:16
  // GFX10: encoding: [0x10,0x80,0x58,0xdc,0x00,0x00,0x02,0x01]
diff --git a/llvm/test/MC/Disassembler/AMDGPU/gfx1030_dasm_new.txt b/llvm/test/MC/Disassembler/AMDGPU/gfx1030_dasm_new.txt

index eb9b7e2..ba4348b 100644 (file)
--- a/llvm/test/MC/Disassembler/AMDGPU/gfx1030_dasm_new.txt
+++ b/llvm/test/MC/Disassembler/AMDGPU/gfx1030_dasm_new.txt
@@ -1,4 +1,5 @@
  # RUN: llvm-mc -arch=amdgcn -mcpu=gfx1030 -disassemble -show-encoding < %s | FileCheck -check-prefix=GFX10 %s
+# RUN: llvm-mc -arch=amdgcn -mcpu=gfx1031 -disassemble -show-encoding < %s | FileCheck -check-prefix=GFX10 %s
  
  # GFX10: global_load_dword_addtid v1, s[2:3] offset:16
  0x10,0x80,0x58,0xdc,0x00,0x00,0x02,0x01
diff --git a/llvm/tools/llvm-readobj/ELFDumper.cpp b/llvm/tools/llvm-readobj/ELFDumper.cpp

index 54b2d67..aca3385 100644 (file)
--- a/llvm/tools/llvm-readobj/ELFDumper.cpp
+++ b/llvm/tools/llvm-readobj/ELFDumper.cpp
@@ -1841,6 +1841,7 @@ static const EnumEntry<unsigned> ElfHeaderAMDGPUFlags[] = {
    LLVM_READOBJ_ENUM_ENT(ELF, EF_AMDGPU_MACH_AMDGCN_GFX1011),
    LLVM_READOBJ_ENUM_ENT(ELF, EF_AMDGPU_MACH_AMDGCN_GFX1012),
    LLVM_READOBJ_ENUM_ENT(ELF, EF_AMDGPU_MACH_AMDGCN_GFX1030),
+  LLVM_READOBJ_ENUM_ENT(ELF, EF_AMDGPU_MACH_AMDGCN_GFX1031),
    LLVM_READOBJ_ENUM_ENT(ELF, EF_AMDGPU_XNACK),
    LLVM_READOBJ_ENUM_ENT(ELF, EF_AMDGPU_SRAM_ECC)
  };
author	Stanislav Mekhanoshin <Stanislav.Mekhanoshin@amd.com>
	Wed, 5 Aug 2020 19:00:52 +0000 (12:00 -0700)
committer	Stanislav Mekhanoshin <Stanislav.Mekhanoshin@amd.com>
	Wed, 5 Aug 2020 19:36:26 +0000 (12:36 -0700)
clang/include/clang/Basic/Cuda.h		patch \| blob \| history
clang/lib/Basic/Targets/AMDGPU.cpp		patch \| blob \| history
clang/lib/Basic/Targets/NVPTX.cpp		patch \| blob \| history
clang/test/CodeGenOpenCL/amdgpu-features.cl		patch \| blob \| history
clang/test/Driver/amdgpu-macros.cl		patch \| blob \| history
clang/test/Driver/amdgpu-mcpu.cl		patch \| blob \| history
llvm/docs/AMDGPUUsage.rst		patch \| blob \| history
llvm/include/llvm/BinaryFormat/ELF.h		patch \| blob \| history
llvm/include/llvm/Support/TargetParser.h		patch \| blob \| history
llvm/lib/ObjectYAML/ELFYAML.cpp		patch \| blob \| history
llvm/lib/Support/TargetParser.cpp		patch \| blob \| history
llvm/lib/Target/AMDGPU/GCNProcessors.td		patch \| blob \| history
llvm/lib/Target/AMDGPU/MCTargetDesc/AMDGPUTargetStreamer.cpp		patch \| blob \| history
llvm/test/CodeGen/AMDGPU/GlobalISel/legalize-fmad.s32.mir		patch \| blob \| history
llvm/test/CodeGen/AMDGPU/GlobalISel/llvm.amdgcn.global.atomic.csub.ll		patch \| blob \| history
llvm/test/CodeGen/AMDGPU/elf-header-flags-mach.ll		patch \| blob \| history
llvm/test/CodeGen/AMDGPU/hsa-note-no-func.ll		patch \| blob \| history
llvm/test/CodeGen/AMDGPU/idot8s.ll		patch \| blob \| history
llvm/test/CodeGen/AMDGPU/llvm.amdgcn.atomic.csub.ll		patch \| blob \| history
llvm/test/CodeGen/AMDGPU/llvm.amdgcn.sdot4.ll		patch \| blob \| history
llvm/test/CodeGen/AMDGPU/llvm.amdgcn.sdot8.ll		patch \| blob \| history
llvm/test/MC/AMDGPU/gfx1030_err.s		patch \| blob \| history
llvm/test/MC/AMDGPU/gfx1030_new.s		patch \| blob \| history
llvm/test/MC/Disassembler/AMDGPU/gfx1030_dasm_new.txt		patch \| blob \| history
llvm/tools/llvm-readobj/ELFDumper.cpp		patch \| blob \| history