1 //===-- AMDGPU.h - MachineFunction passes hw codegen --------------*- C++ -*-=// 2 // 3 // The LLVM Compiler Infrastructure 4 // 5 // This file is distributed under the University of Illinois Open Source 6 // License. See LICENSE.TXT for details. 7 // 8 /// \file 9 //===----------------------------------------------------------------------===// 10 11 #ifndef LLVM_LIB_TARGET_AMDGPU_AMDGPU_H 12 #define LLVM_LIB_TARGET_AMDGPU_AMDGPU_H 13 14 #include "llvm/Support/TargetRegistry.h" 15 #include "llvm/Target/TargetMachine.h" 16 17 namespace llvm { 18 19 class AMDGPUInstrPrinter; 20 class AMDGPUSubtarget; 21 class AMDGPUTargetMachine; 22 class FunctionPass; 23 struct MachineSchedContext; 24 class MCAsmInfo; 25 class raw_ostream; 26 class ScheduleDAGInstrs; 27 class Target; 28 class TargetMachine; 29 30 // R600 Passes 31 FunctionPass *createR600VectorRegMerger(TargetMachine &tm); 32 FunctionPass *createR600TextureIntrinsicsReplacer(); 33 FunctionPass *createR600ExpandSpecialInstrsPass(TargetMachine &tm); 34 FunctionPass *createR600EmitClauseMarkers(); 35 FunctionPass *createR600ClauseMergePass(TargetMachine &tm); 36 FunctionPass *createR600Packetizer(TargetMachine &tm); 37 FunctionPass *createR600ControlFlowFinalizer(TargetMachine &tm); 38 FunctionPass *createAMDGPUCFGStructurizerPass(); 39 40 // SI Passes 41 FunctionPass *createSITypeRewriter(); 42 FunctionPass *createSIAnnotateControlFlowPass(); 43 FunctionPass *createSIFoldOperandsPass(); 44 FunctionPass *createSILowerI1CopiesPass(); 45 FunctionPass *createSIShrinkInstructionsPass(); 46 FunctionPass *createSILoadStoreOptimizerPass(TargetMachine &tm); 47 FunctionPass *createSIWholeQuadModePass(); 48 FunctionPass *createSILowerControlFlowPass(); 49 FunctionPass *createSIFixControlFlowLiveIntervalsPass(); 50 FunctionPass *createSIFixSGPRCopiesPass(); 51 FunctionPass *createSICodeEmitterPass(formatted_raw_ostream &OS); 52 FunctionPass *createSIDebuggerInsertNopsPass(); 53 FunctionPass *createSIInsertWaitsPass(); 54 55 ScheduleDAGInstrs *createSIMachineScheduler(MachineSchedContext *C); 56 57 ModulePass *createAMDGPUAnnotateKernelFeaturesPass(); 58 void initializeAMDGPUAnnotateKernelFeaturesPass(PassRegistry &); 59 extern char &AMDGPUAnnotateKernelFeaturesID; 60 61 void initializeSIFoldOperandsPass(PassRegistry &); 62 extern char &SIFoldOperandsID; 63 64 void initializeSIFixSGPRCopiesPass(PassRegistry &); 65 extern char &SIFixSGPRCopiesID; 66 67 void initializeSILowerI1CopiesPass(PassRegistry &); 68 extern char &SILowerI1CopiesID; 69 70 void initializeSILoadStoreOptimizerPass(PassRegistry &); 71 extern char &SILoadStoreOptimizerID; 72 73 void initializeSIWholeQuadModePass(PassRegistry &); 74 extern char &SIWholeQuadModeID; 75 76 void initializeSILowerControlFlowPass(PassRegistry &); 77 extern char &SILowerControlFlowPassID; 78 79 80 // Passes common to R600 and SI 81 FunctionPass *createAMDGPUPromoteAlloca(const TargetMachine *TM = nullptr); 82 void initializeAMDGPUPromoteAllocaPass(PassRegistry&); 83 extern char &AMDGPUPromoteAllocaID; 84 85 FunctionPass *createAMDGPUAddDivergenceMetadata(const AMDGPUSubtarget &ST); 86 Pass *createAMDGPUStructurizeCFGPass(); 87 FunctionPass *createAMDGPUISelDag(TargetMachine &tm); 88 ModulePass *createAMDGPUAlwaysInlinePass(); 89 ModulePass *createAMDGPUOpenCLImageTypeLoweringPass(); 90 FunctionPass *createAMDGPUAnnotateUniformValues(); 91 92 void initializeSIFixControlFlowLiveIntervalsPass(PassRegistry&); 93 extern char &SIFixControlFlowLiveIntervalsID; 94 95 void initializeAMDGPUAnnotateUniformValuesPass(PassRegistry&); 96 extern char &AMDGPUAnnotateUniformValuesPassID; 97 98 void initializeSIAnnotateControlFlowPass(PassRegistry&); 99 extern char &SIAnnotateControlFlowPassID; 100 101 void initializeSIDebuggerInsertNopsPass(PassRegistry&); 102 extern char &SIDebuggerInsertNopsID; 103 104 void initializeSIInsertWaitsPass(PassRegistry&); 105 extern char &SIInsertWaitsID; 106 107 extern Target TheAMDGPUTarget; 108 extern Target TheGCNTarget; 109 110 namespace AMDGPU { 111 enum TargetIndex { 112 TI_CONSTDATA_START, 113 TI_SCRATCH_RSRC_DWORD0, 114 TI_SCRATCH_RSRC_DWORD1, 115 TI_SCRATCH_RSRC_DWORD2, 116 TI_SCRATCH_RSRC_DWORD3 117 }; 118 } 119 120 } // End namespace llvm 121 122 /// OpenCL uses address spaces to differentiate between 123 /// various memory regions on the hardware. On the CPU 124 /// all of the address spaces point to the same memory, 125 /// however on the GPU, each address space points to 126 /// a separate piece of memory that is unique from other 127 /// memory locations. 128 namespace AMDGPUAS { 129 enum AddressSpaces : unsigned { 130 PRIVATE_ADDRESS = 0, ///< Address space for private memory. 131 GLOBAL_ADDRESS = 1, ///< Address space for global memory (RAT0, VTX0). 132 CONSTANT_ADDRESS = 2, ///< Address space for constant memory (VTX2) 133 LOCAL_ADDRESS = 3, ///< Address space for local memory. 134 FLAT_ADDRESS = 4, ///< Address space for flat memory. 135 REGION_ADDRESS = 5, ///< Address space for region memory. 136 PARAM_D_ADDRESS = 6, ///< Address space for direct addressible parameter memory (CONST0) 137 PARAM_I_ADDRESS = 7, ///< Address space for indirect addressible parameter memory (VTX1) 138 139 // Do not re-order the CONSTANT_BUFFER_* enums. Several places depend on this 140 // order to be able to dynamically index a constant buffer, for example: 141 // 142 // ConstantBufferAS = CONSTANT_BUFFER_0 + CBIdx 143 144 CONSTANT_BUFFER_0 = 8, 145 CONSTANT_BUFFER_1 = 9, 146 CONSTANT_BUFFER_2 = 10, 147 CONSTANT_BUFFER_3 = 11, 148 CONSTANT_BUFFER_4 = 12, 149 CONSTANT_BUFFER_5 = 13, 150 CONSTANT_BUFFER_6 = 14, 151 CONSTANT_BUFFER_7 = 15, 152 CONSTANT_BUFFER_8 = 16, 153 CONSTANT_BUFFER_9 = 17, 154 CONSTANT_BUFFER_10 = 18, 155 CONSTANT_BUFFER_11 = 19, 156 CONSTANT_BUFFER_12 = 20, 157 CONSTANT_BUFFER_13 = 21, 158 CONSTANT_BUFFER_14 = 22, 159 CONSTANT_BUFFER_15 = 23, 160 161 // Some places use this if the address space can't be determined. 162 UNKNOWN_ADDRESS_SPACE = ~0u 163 }; 164 165 } // namespace AMDGPUAS 166 167 #endif 168