1 //===- llvm/lib/Target/X86/X86CallLowering.cpp - Call lowering ------------===// 2 // 3 // Part of the LLVM Project, under the Apache License v2.0 with LLVM Exceptions. 4 // See https://llvm.org/LICENSE.txt for license information. 5 // SPDX-License-Identifier: Apache-2.0 WITH LLVM-exception 6 // 7 //===----------------------------------------------------------------------===// 8 // 9 /// \file 10 /// This file implements the lowering of LLVM calls to machine code calls for 11 /// GlobalISel. 12 // 13 //===----------------------------------------------------------------------===// 14 15 #include "X86CallLowering.h" 16 #include "X86CallingConv.h" 17 #include "X86ISelLowering.h" 18 #include "X86InstrInfo.h" 19 #include "X86RegisterInfo.h" 20 #include "X86Subtarget.h" 21 #include "llvm/ADT/ArrayRef.h" 22 #include "llvm/ADT/SmallVector.h" 23 #include "llvm/CodeGen/Analysis.h" 24 #include "llvm/CodeGen/CallingConvLower.h" 25 #include "llvm/CodeGen/GlobalISel/MachineIRBuilder.h" 26 #include "llvm/CodeGen/GlobalISel/Utils.h" 27 #include "llvm/CodeGen/LowLevelType.h" 28 #include "llvm/CodeGen/MachineBasicBlock.h" 29 #include "llvm/CodeGen/MachineFrameInfo.h" 30 #include "llvm/CodeGen/MachineFunction.h" 31 #include "llvm/CodeGen/MachineInstrBuilder.h" 32 #include "llvm/CodeGen/MachineMemOperand.h" 33 #include "llvm/CodeGen/MachineOperand.h" 34 #include "llvm/CodeGen/MachineRegisterInfo.h" 35 #include "llvm/CodeGen/TargetInstrInfo.h" 36 #include "llvm/CodeGen/TargetSubtargetInfo.h" 37 #include "llvm/CodeGen/ValueTypes.h" 38 #include "llvm/IR/Attributes.h" 39 #include "llvm/IR/DataLayout.h" 40 #include "llvm/IR/Function.h" 41 #include "llvm/IR/Value.h" 42 #include "llvm/MC/MCRegisterInfo.h" 43 #include "llvm/Support/LowLevelTypeImpl.h" 44 #include "llvm/Support/MachineValueType.h" 45 #include <cassert> 46 #include <cstdint> 47 48 using namespace llvm; 49 50 X86CallLowering::X86CallLowering(const X86TargetLowering &TLI) 51 : CallLowering(&TLI) {} 52 53 bool X86CallLowering::splitToValueTypes(const ArgInfo &OrigArg, 54 SmallVectorImpl<ArgInfo> &SplitArgs, 55 const DataLayout &DL, 56 MachineRegisterInfo &MRI, 57 SplitArgTy PerformArgSplit) const { 58 const X86TargetLowering &TLI = *getTLI<X86TargetLowering>(); 59 LLVMContext &Context = OrigArg.Ty->getContext(); 60 61 SmallVector<EVT, 4> SplitVTs; 62 SmallVector<uint64_t, 4> Offsets; 63 ComputeValueVTs(TLI, DL, OrigArg.Ty, SplitVTs, &Offsets, 0); 64 assert(OrigArg.Regs.size() == 1 && "Can't handle multple regs yet"); 65 66 if (OrigArg.Ty->isVoidTy()) 67 return true; 68 69 EVT VT = SplitVTs[0]; 70 unsigned NumParts = TLI.getNumRegisters(Context, VT); 71 72 if (NumParts == 1) { 73 // replace the original type ( pointer -> GPR ). 74 SplitArgs.emplace_back(OrigArg.Regs[0], VT.getTypeForEVT(Context), 75 OrigArg.Flags, OrigArg.IsFixed); 76 return true; 77 } 78 79 SmallVector<Register, 8> SplitRegs; 80 81 EVT PartVT = TLI.getRegisterType(Context, VT); 82 Type *PartTy = PartVT.getTypeForEVT(Context); 83 84 for (unsigned i = 0; i < NumParts; ++i) { 85 ArgInfo Info = 86 ArgInfo{MRI.createGenericVirtualRegister(getLLTForType(*PartTy, DL)), 87 PartTy, OrigArg.Flags}; 88 SplitArgs.push_back(Info); 89 SplitRegs.push_back(Info.Regs[0]); 90 } 91 92 PerformArgSplit(SplitRegs); 93 return true; 94 } 95 96 namespace { 97 98 struct OutgoingValueHandler : public CallLowering::ValueHandler { 99 OutgoingValueHandler(MachineIRBuilder &MIRBuilder, MachineRegisterInfo &MRI, 100 MachineInstrBuilder &MIB, CCAssignFn *AssignFn) 101 : ValueHandler(MIRBuilder, MRI, AssignFn), MIB(MIB), 102 DL(MIRBuilder.getMF().getDataLayout()), 103 STI(MIRBuilder.getMF().getSubtarget<X86Subtarget>()) {} 104 105 bool isIncomingArgumentHandler() const override { return false; } 106 107 Register getStackAddress(uint64_t Size, int64_t Offset, 108 MachinePointerInfo &MPO) override { 109 LLT p0 = LLT::pointer(0, DL.getPointerSizeInBits(0)); 110 LLT SType = LLT::scalar(DL.getPointerSizeInBits(0)); 111 auto SPReg = 112 MIRBuilder.buildCopy(p0, STI.getRegisterInfo()->getStackRegister()); 113 114 auto OffsetReg = MIRBuilder.buildConstant(SType, Offset); 115 116 auto AddrReg = MIRBuilder.buildPtrAdd(p0, SPReg, OffsetReg); 117 118 MPO = MachinePointerInfo::getStack(MIRBuilder.getMF(), Offset); 119 return AddrReg.getReg(0); 120 } 121 122 void assignValueToReg(Register ValVReg, Register PhysReg, 123 CCValAssign &VA) override { 124 MIB.addUse(PhysReg, RegState::Implicit); 125 126 Register ExtReg; 127 // If we are copying the value to a physical register with the 128 // size larger than the size of the value itself - build AnyExt 129 // to the size of the register first and only then do the copy. 130 // The example of that would be copying from s32 to xmm0, for which 131 // case ValVT == LocVT == MVT::f32. If LocSize and ValSize are not equal 132 // we expect normal extendRegister mechanism to work. 133 unsigned PhysRegSize = 134 MRI.getTargetRegisterInfo()->getRegSizeInBits(PhysReg, MRI); 135 unsigned ValSize = VA.getValVT().getSizeInBits(); 136 unsigned LocSize = VA.getLocVT().getSizeInBits(); 137 if (PhysRegSize > ValSize && LocSize == ValSize) { 138 assert((PhysRegSize == 128 || PhysRegSize == 80) && "We expect that to be 128 bit"); 139 auto MIB = MIRBuilder.buildAnyExt(LLT::scalar(PhysRegSize), ValVReg); 140 ExtReg = MIB.getReg(0); 141 } else 142 ExtReg = extendRegister(ValVReg, VA); 143 144 MIRBuilder.buildCopy(PhysReg, ExtReg); 145 } 146 147 void assignValueToAddress(Register ValVReg, Register Addr, uint64_t Size, 148 MachinePointerInfo &MPO, CCValAssign &VA) override { 149 MachineFunction &MF = MIRBuilder.getMF(); 150 Register ExtReg = extendRegister(ValVReg, VA); 151 unsigned Align = inferAlignmentFromPtrInfo(MF, MPO); 152 153 auto MMO = MF.getMachineMemOperand( 154 MPO, MachineMemOperand::MOStore, VA.getLocVT().getStoreSize(), 155 Align); 156 MIRBuilder.buildStore(ExtReg, Addr, *MMO); 157 } 158 159 bool assignArg(unsigned ValNo, MVT ValVT, MVT LocVT, 160 CCValAssign::LocInfo LocInfo, 161 const CallLowering::ArgInfo &Info, ISD::ArgFlagsTy Flags, 162 CCState &State) override { 163 bool Res = AssignFn(ValNo, ValVT, LocVT, LocInfo, Flags, State); 164 StackSize = State.getNextStackOffset(); 165 166 static const MCPhysReg XMMArgRegs[] = {X86::XMM0, X86::XMM1, X86::XMM2, 167 X86::XMM3, X86::XMM4, X86::XMM5, 168 X86::XMM6, X86::XMM7}; 169 if (!Info.IsFixed) 170 NumXMMRegs = State.getFirstUnallocated(XMMArgRegs); 171 172 return Res; 173 } 174 175 uint64_t getStackSize() { return StackSize; } 176 uint64_t getNumXmmRegs() { return NumXMMRegs; } 177 178 protected: 179 MachineInstrBuilder &MIB; 180 uint64_t StackSize = 0; 181 const DataLayout &DL; 182 const X86Subtarget &STI; 183 unsigned NumXMMRegs = 0; 184 }; 185 186 } // end anonymous namespace 187 188 bool X86CallLowering::lowerReturn( 189 MachineIRBuilder &MIRBuilder, const Value *Val, 190 ArrayRef<Register> VRegs) const { 191 assert(((Val && !VRegs.empty()) || (!Val && VRegs.empty())) && 192 "Return value without a vreg"); 193 auto MIB = MIRBuilder.buildInstrNoInsert(X86::RET).addImm(0); 194 195 if (!VRegs.empty()) { 196 MachineFunction &MF = MIRBuilder.getMF(); 197 const Function &F = MF.getFunction(); 198 MachineRegisterInfo &MRI = MF.getRegInfo(); 199 auto &DL = MF.getDataLayout(); 200 LLVMContext &Ctx = Val->getType()->getContext(); 201 const X86TargetLowering &TLI = *getTLI<X86TargetLowering>(); 202 203 SmallVector<EVT, 4> SplitEVTs; 204 ComputeValueVTs(TLI, DL, Val->getType(), SplitEVTs); 205 assert(VRegs.size() == SplitEVTs.size() && 206 "For each split Type there should be exactly one VReg."); 207 208 SmallVector<ArgInfo, 8> SplitArgs; 209 for (unsigned i = 0; i < SplitEVTs.size(); ++i) { 210 ArgInfo CurArgInfo = ArgInfo{VRegs[i], SplitEVTs[i].getTypeForEVT(Ctx)}; 211 setArgFlags(CurArgInfo, AttributeList::ReturnIndex, DL, F); 212 if (!splitToValueTypes(CurArgInfo, SplitArgs, DL, MRI, 213 [&](ArrayRef<Register> Regs) { 214 MIRBuilder.buildUnmerge(Regs, VRegs[i]); 215 })) 216 return false; 217 } 218 219 OutgoingValueHandler Handler(MIRBuilder, MRI, MIB, RetCC_X86); 220 if (!handleAssignments(MIRBuilder, SplitArgs, Handler)) 221 return false; 222 } 223 224 MIRBuilder.insertInstr(MIB); 225 return true; 226 } 227 228 namespace { 229 230 struct IncomingValueHandler : public CallLowering::ValueHandler { 231 IncomingValueHandler(MachineIRBuilder &MIRBuilder, MachineRegisterInfo &MRI, 232 CCAssignFn *AssignFn) 233 : ValueHandler(MIRBuilder, MRI, AssignFn), 234 DL(MIRBuilder.getMF().getDataLayout()) {} 235 236 bool isIncomingArgumentHandler() const override { return true; } 237 238 Register getStackAddress(uint64_t Size, int64_t Offset, 239 MachinePointerInfo &MPO) override { 240 auto &MFI = MIRBuilder.getMF().getFrameInfo(); 241 int FI = MFI.CreateFixedObject(Size, Offset, true); 242 MPO = MachinePointerInfo::getFixedStack(MIRBuilder.getMF(), FI); 243 244 return MIRBuilder 245 .buildFrameIndex(LLT::pointer(0, DL.getPointerSizeInBits(0)), FI) 246 .getReg(0); 247 } 248 249 void assignValueToAddress(Register ValVReg, Register Addr, uint64_t Size, 250 MachinePointerInfo &MPO, CCValAssign &VA) override { 251 MachineFunction &MF = MIRBuilder.getMF(); 252 unsigned Align = inferAlignmentFromPtrInfo(MF, MPO); 253 auto MMO = MF.getMachineMemOperand( 254 MPO, MachineMemOperand::MOLoad | MachineMemOperand::MOInvariant, Size, 255 Align); 256 MIRBuilder.buildLoad(ValVReg, Addr, *MMO); 257 } 258 259 void assignValueToReg(Register ValVReg, Register PhysReg, 260 CCValAssign &VA) override { 261 markPhysRegUsed(PhysReg); 262 263 switch (VA.getLocInfo()) { 264 default: { 265 // If we are copying the value from a physical register with the 266 // size larger than the size of the value itself - build the copy 267 // of the phys reg first and then build the truncation of that copy. 268 // The example of that would be copying from xmm0 to s32, for which 269 // case ValVT == LocVT == MVT::f32. If LocSize and ValSize are not equal 270 // we expect this to be handled in SExt/ZExt/AExt case. 271 unsigned PhysRegSize = 272 MRI.getTargetRegisterInfo()->getRegSizeInBits(PhysReg, MRI); 273 unsigned ValSize = VA.getValVT().getSizeInBits(); 274 unsigned LocSize = VA.getLocVT().getSizeInBits(); 275 if (PhysRegSize > ValSize && LocSize == ValSize) { 276 auto Copy = MIRBuilder.buildCopy(LLT::scalar(PhysRegSize), PhysReg); 277 MIRBuilder.buildTrunc(ValVReg, Copy); 278 return; 279 } 280 281 MIRBuilder.buildCopy(ValVReg, PhysReg); 282 break; 283 } 284 case CCValAssign::LocInfo::SExt: 285 case CCValAssign::LocInfo::ZExt: 286 case CCValAssign::LocInfo::AExt: { 287 auto Copy = MIRBuilder.buildCopy(LLT{VA.getLocVT()}, PhysReg); 288 MIRBuilder.buildTrunc(ValVReg, Copy); 289 break; 290 } 291 } 292 } 293 294 /// How the physical register gets marked varies between formal 295 /// parameters (it's a basic-block live-in), and a call instruction 296 /// (it's an implicit-def of the BL). 297 virtual void markPhysRegUsed(unsigned PhysReg) = 0; 298 299 protected: 300 const DataLayout &DL; 301 }; 302 303 struct FormalArgHandler : public IncomingValueHandler { 304 FormalArgHandler(MachineIRBuilder &MIRBuilder, MachineRegisterInfo &MRI, 305 CCAssignFn *AssignFn) 306 : IncomingValueHandler(MIRBuilder, MRI, AssignFn) {} 307 308 void markPhysRegUsed(unsigned PhysReg) override { 309 MIRBuilder.getMRI()->addLiveIn(PhysReg); 310 MIRBuilder.getMBB().addLiveIn(PhysReg); 311 } 312 }; 313 314 struct CallReturnHandler : public IncomingValueHandler { 315 CallReturnHandler(MachineIRBuilder &MIRBuilder, MachineRegisterInfo &MRI, 316 CCAssignFn *AssignFn, MachineInstrBuilder &MIB) 317 : IncomingValueHandler(MIRBuilder, MRI, AssignFn), MIB(MIB) {} 318 319 void markPhysRegUsed(unsigned PhysReg) override { 320 MIB.addDef(PhysReg, RegState::Implicit); 321 } 322 323 protected: 324 MachineInstrBuilder &MIB; 325 }; 326 327 } // end anonymous namespace 328 329 bool X86CallLowering::lowerFormalArguments( 330 MachineIRBuilder &MIRBuilder, const Function &F, 331 ArrayRef<ArrayRef<Register>> VRegs) const { 332 if (F.arg_empty()) 333 return true; 334 335 // TODO: handle variadic function 336 if (F.isVarArg()) 337 return false; 338 339 MachineFunction &MF = MIRBuilder.getMF(); 340 MachineRegisterInfo &MRI = MF.getRegInfo(); 341 auto DL = MF.getDataLayout(); 342 343 SmallVector<ArgInfo, 8> SplitArgs; 344 unsigned Idx = 0; 345 for (auto &Arg : F.args()) { 346 347 // TODO: handle not simple cases. 348 if (Arg.hasAttribute(Attribute::ByVal) || 349 Arg.hasAttribute(Attribute::InReg) || 350 Arg.hasAttribute(Attribute::StructRet) || 351 Arg.hasAttribute(Attribute::SwiftSelf) || 352 Arg.hasAttribute(Attribute::SwiftError) || 353 Arg.hasAttribute(Attribute::Nest) || VRegs[Idx].size() > 1) 354 return false; 355 356 ArgInfo OrigArg(VRegs[Idx], Arg.getType()); 357 setArgFlags(OrigArg, Idx + AttributeList::FirstArgIndex, DL, F); 358 if (!splitToValueTypes(OrigArg, SplitArgs, DL, MRI, 359 [&](ArrayRef<Register> Regs) { 360 MIRBuilder.buildMerge(VRegs[Idx][0], Regs); 361 })) 362 return false; 363 Idx++; 364 } 365 366 MachineBasicBlock &MBB = MIRBuilder.getMBB(); 367 if (!MBB.empty()) 368 MIRBuilder.setInstr(*MBB.begin()); 369 370 FormalArgHandler Handler(MIRBuilder, MRI, CC_X86); 371 if (!handleAssignments(MIRBuilder, SplitArgs, Handler)) 372 return false; 373 374 // Move back to the end of the basic block. 375 MIRBuilder.setMBB(MBB); 376 377 return true; 378 } 379 380 bool X86CallLowering::lowerCall(MachineIRBuilder &MIRBuilder, 381 CallLoweringInfo &Info) const { 382 MachineFunction &MF = MIRBuilder.getMF(); 383 const Function &F = MF.getFunction(); 384 MachineRegisterInfo &MRI = MF.getRegInfo(); 385 auto &DL = F.getParent()->getDataLayout(); 386 const X86Subtarget &STI = MF.getSubtarget<X86Subtarget>(); 387 const TargetInstrInfo &TII = *STI.getInstrInfo(); 388 auto TRI = STI.getRegisterInfo(); 389 390 // Handle only Linux C, X86_64_SysV calling conventions for now. 391 if (!STI.isTargetLinux() || !(Info.CallConv == CallingConv::C || 392 Info.CallConv == CallingConv::X86_64_SysV)) 393 return false; 394 395 unsigned AdjStackDown = TII.getCallFrameSetupOpcode(); 396 auto CallSeqStart = MIRBuilder.buildInstr(AdjStackDown); 397 398 // Create a temporarily-floating call instruction so we can add the implicit 399 // uses of arg registers. 400 bool Is64Bit = STI.is64Bit(); 401 unsigned CallOpc = Info.Callee.isReg() 402 ? (Is64Bit ? X86::CALL64r : X86::CALL32r) 403 : (Is64Bit ? X86::CALL64pcrel32 : X86::CALLpcrel32); 404 405 auto MIB = MIRBuilder.buildInstrNoInsert(CallOpc) 406 .add(Info.Callee) 407 .addRegMask(TRI->getCallPreservedMask(MF, Info.CallConv)); 408 409 SmallVector<ArgInfo, 8> SplitArgs; 410 for (const auto &OrigArg : Info.OrigArgs) { 411 412 // TODO: handle not simple cases. 413 if (OrigArg.Flags[0].isByVal()) 414 return false; 415 416 if (OrigArg.Regs.size() > 1) 417 return false; 418 419 if (!splitToValueTypes(OrigArg, SplitArgs, DL, MRI, 420 [&](ArrayRef<Register> Regs) { 421 MIRBuilder.buildUnmerge(Regs, OrigArg.Regs[0]); 422 })) 423 return false; 424 } 425 // Do the actual argument marshalling. 426 OutgoingValueHandler Handler(MIRBuilder, MRI, MIB, CC_X86); 427 if (!handleAssignments(MIRBuilder, SplitArgs, Handler)) 428 return false; 429 430 bool IsFixed = Info.OrigArgs.empty() ? true : Info.OrigArgs.back().IsFixed; 431 if (STI.is64Bit() && !IsFixed && !STI.isCallingConvWin64(Info.CallConv)) { 432 // From AMD64 ABI document: 433 // For calls that may call functions that use varargs or stdargs 434 // (prototype-less calls or calls to functions containing ellipsis (...) in 435 // the declaration) %al is used as hidden argument to specify the number 436 // of SSE registers used. The contents of %al do not need to match exactly 437 // the number of registers, but must be an ubound on the number of SSE 438 // registers used and is in the range 0 - 8 inclusive. 439 440 MIRBuilder.buildInstr(X86::MOV8ri) 441 .addDef(X86::AL) 442 .addImm(Handler.getNumXmmRegs()); 443 MIB.addUse(X86::AL, RegState::Implicit); 444 } 445 446 // Now we can add the actual call instruction to the correct basic block. 447 MIRBuilder.insertInstr(MIB); 448 449 // If Callee is a reg, since it is used by a target specific 450 // instruction, it must have a register class matching the 451 // constraint of that instruction. 452 if (Info.Callee.isReg()) 453 MIB->getOperand(0).setReg(constrainOperandRegClass( 454 MF, *TRI, MRI, *MF.getSubtarget().getInstrInfo(), 455 *MF.getSubtarget().getRegBankInfo(), *MIB, MIB->getDesc(), Info.Callee, 456 0)); 457 458 // Finally we can copy the returned value back into its virtual-register. In 459 // symmetry with the arguments, the physical register must be an 460 // implicit-define of the call instruction. 461 462 if (!Info.OrigRet.Ty->isVoidTy()) { 463 if (Info.OrigRet.Regs.size() > 1) 464 return false; 465 466 SplitArgs.clear(); 467 SmallVector<Register, 8> NewRegs; 468 469 if (!splitToValueTypes(Info.OrigRet, SplitArgs, DL, MRI, 470 [&](ArrayRef<Register> Regs) { 471 NewRegs.assign(Regs.begin(), Regs.end()); 472 })) 473 return false; 474 475 CallReturnHandler Handler(MIRBuilder, MRI, RetCC_X86, MIB); 476 if (!handleAssignments(MIRBuilder, SplitArgs, Handler)) 477 return false; 478 479 if (!NewRegs.empty()) 480 MIRBuilder.buildMerge(Info.OrigRet.Regs[0], NewRegs); 481 } 482 483 CallSeqStart.addImm(Handler.getStackSize()) 484 .addImm(0 /* see getFrameTotalSize */) 485 .addImm(0 /* see getFrameAdjustment */); 486 487 unsigned AdjStackUp = TII.getCallFrameDestroyOpcode(); 488 MIRBuilder.buildInstr(AdjStackUp) 489 .addImm(Handler.getStackSize()) 490 .addImm(0 /* NumBytesForCalleeToPop */); 491 492 return true; 493 } 494