lib/Headers/cuda_builtin_vars.h

*67e74705SXin Li/*===---- cuda_builtin_vars.h - CUDA built-in variables ---------------------===
*67e74705SXin Li *
*67e74705SXin Li * Permission is hereby granted, free of charge, to any person obtaining a copy
*67e74705SXin Li * of this software and associated documentation files (the "Software"), to deal
*67e74705SXin Li * in the Software without restriction, including without limitation the rights
*67e74705SXin Li * to use, copy, modify, merge, publish, distribute, sublicense, and/or sell
*67e74705SXin Li * copies of the Software, and to permit persons to whom the Software is
*67e74705SXin Li * furnished to do so, subject to the following conditions:
*67e74705SXin Li *
*67e74705SXin Li * The above copyright notice and this permission notice shall be included in
*67e74705SXin Li * all copies or substantial portions of the Software.
*67e74705SXin Li *
*67e74705SXin Li * THE SOFTWARE IS PROVIDED "AS IS", WITHOUT WARRANTY OF ANY KIND, EXPRESS OR
*67e74705SXin Li * IMPLIED, INCLUDING BUT NOT LIMITED TO THE WARRANTIES OF MERCHANTABILITY,
*67e74705SXin Li * FITNESS FOR A PARTICULAR PURPOSE AND NONINFRINGEMENT. IN NO EVENT SHALL THE
*67e74705SXin Li * AUTHORS OR COPYRIGHT HOLDERS BE LIABLE FOR ANY CLAIM, DAMAGES OR OTHER
*67e74705SXin Li * LIABILITY, WHETHER IN AN ACTION OF CONTRACT, TORT OR OTHERWISE, ARISING FROM,
*67e74705SXin Li * OUT OF OR IN CONNECTION WITH THE SOFTWARE OR THE USE OR OTHER DEALINGS IN
*67e74705SXin Li * THE SOFTWARE.
*67e74705SXin Li *
*67e74705SXin Li *===-----------------------------------------------------------------------===
*67e74705SXin Li */
*67e74705SXin Li
*67e74705SXin Li#ifndef __CUDA_BUILTIN_VARS_H
*67e74705SXin Li#define __CUDA_BUILTIN_VARS_H
*67e74705SXin Li
*67e74705SXin Li// Forward declares from vector_types.h.
*67e74705SXin Listruct uint3;
*67e74705SXin Listruct dim3;
*67e74705SXin Li
*67e74705SXin Li// The file implements built-in CUDA variables using __declspec(property).
*67e74705SXin Li// https://msdn.microsoft.com/en-us/library/yhfk0thd.aspx
*67e74705SXin Li// All read accesses of built-in variable fields get converted into calls to a
*67e74705SXin Li// getter function which in turn calls the appropriate builtin to fetch the
*67e74705SXin Li// value.
*67e74705SXin Li//
*67e74705SXin Li// Example:
*67e74705SXin Li//    int x = threadIdx.x;
*67e74705SXin Li// IR output:
*67e74705SXin Li//  %0 = call i32 @llvm.nvvm.read.ptx.sreg.tid.x() #3
*67e74705SXin Li// PTX output:
*67e74705SXin Li//  mov.u32     %r2, %tid.x;
*67e74705SXin Li
*67e74705SXin Li#define __CUDA_DEVICE_BUILTIN(FIELD, INTRINSIC)                                \
*67e74705SXin Li  __declspec(property(get = __fetch_builtin_##FIELD)) unsigned int FIELD;      \
*67e74705SXin Li  static inline __attribute__((always_inline))                                 \
*67e74705SXin Li      __attribute__((device)) unsigned int __fetch_builtin_##FIELD(void) {     \
*67e74705SXin Li    return INTRINSIC;                                                          \
*67e74705SXin Li  }
*67e74705SXin Li
*67e74705SXin Li#if __cplusplus >= 201103L
*67e74705SXin Li#define __DELETE =delete
*67e74705SXin Li#else
*67e74705SXin Li#define __DELETE
*67e74705SXin Li#endif
*67e74705SXin Li
*67e74705SXin Li// Make sure nobody can create instances of the special varible types.  nvcc
*67e74705SXin Li// also disallows taking address of special variables, so we disable address-of
*67e74705SXin Li// operator as well.
*67e74705SXin Li#define __CUDA_DISALLOW_BUILTINVAR_ACCESS(TypeName)                            \
*67e74705SXin Li  __attribute__((device)) TypeName() __DELETE;                                 \
*67e74705SXin Li  __attribute__((device)) TypeName(const TypeName &) __DELETE;                 \
*67e74705SXin Li  __attribute__((device)) void operator=(const TypeName &) const __DELETE;     \
*67e74705SXin Li  __attribute__((device)) TypeName *operator&() const __DELETE
*67e74705SXin Li
*67e74705SXin Listruct __cuda_builtin_threadIdx_t {
*67e74705SXin Li  __CUDA_DEVICE_BUILTIN(x,__nvvm_read_ptx_sreg_tid_x());
*67e74705SXin Li  __CUDA_DEVICE_BUILTIN(y,__nvvm_read_ptx_sreg_tid_y());
*67e74705SXin Li  __CUDA_DEVICE_BUILTIN(z,__nvvm_read_ptx_sreg_tid_z());
*67e74705SXin Li  // threadIdx should be convertible to uint3 (in fact in nvcc, it *is* a
*67e74705SXin Li  // uint3).  This function is defined after we pull in vector_types.h.
*67e74705SXin Li  __attribute__((device)) operator uint3() const;
*67e74705SXin Liprivate:
*67e74705SXin Li  __CUDA_DISALLOW_BUILTINVAR_ACCESS(__cuda_builtin_threadIdx_t);
*67e74705SXin Li};
*67e74705SXin Li
*67e74705SXin Listruct __cuda_builtin_blockIdx_t {
*67e74705SXin Li  __CUDA_DEVICE_BUILTIN(x,__nvvm_read_ptx_sreg_ctaid_x());
*67e74705SXin Li  __CUDA_DEVICE_BUILTIN(y,__nvvm_read_ptx_sreg_ctaid_y());
*67e74705SXin Li  __CUDA_DEVICE_BUILTIN(z,__nvvm_read_ptx_sreg_ctaid_z());
*67e74705SXin Li  // blockIdx should be convertible to uint3 (in fact in nvcc, it *is* a
*67e74705SXin Li  // uint3).  This function is defined after we pull in vector_types.h.
*67e74705SXin Li  __attribute__((device)) operator uint3() const;
*67e74705SXin Liprivate:
*67e74705SXin Li  __CUDA_DISALLOW_BUILTINVAR_ACCESS(__cuda_builtin_blockIdx_t);
*67e74705SXin Li};
*67e74705SXin Li
*67e74705SXin Listruct __cuda_builtin_blockDim_t {
*67e74705SXin Li  __CUDA_DEVICE_BUILTIN(x,__nvvm_read_ptx_sreg_ntid_x());
*67e74705SXin Li  __CUDA_DEVICE_BUILTIN(y,__nvvm_read_ptx_sreg_ntid_y());
*67e74705SXin Li  __CUDA_DEVICE_BUILTIN(z,__nvvm_read_ptx_sreg_ntid_z());
*67e74705SXin Li  // blockDim should be convertible to dim3 (in fact in nvcc, it *is* a
*67e74705SXin Li  // dim3).  This function is defined after we pull in vector_types.h.
*67e74705SXin Li  __attribute__((device)) operator dim3() const;
*67e74705SXin Liprivate:
*67e74705SXin Li  __CUDA_DISALLOW_BUILTINVAR_ACCESS(__cuda_builtin_blockDim_t);
*67e74705SXin Li};
*67e74705SXin Li
*67e74705SXin Listruct __cuda_builtin_gridDim_t {
*67e74705SXin Li  __CUDA_DEVICE_BUILTIN(x,__nvvm_read_ptx_sreg_nctaid_x());
*67e74705SXin Li  __CUDA_DEVICE_BUILTIN(y,__nvvm_read_ptx_sreg_nctaid_y());
*67e74705SXin Li  __CUDA_DEVICE_BUILTIN(z,__nvvm_read_ptx_sreg_nctaid_z());
*67e74705SXin Li  // gridDim should be convertible to dim3 (in fact in nvcc, it *is* a
*67e74705SXin Li  // dim3).  This function is defined after we pull in vector_types.h.
*67e74705SXin Li  __attribute__((device)) operator dim3() const;
*67e74705SXin Liprivate:
*67e74705SXin Li  __CUDA_DISALLOW_BUILTINVAR_ACCESS(__cuda_builtin_gridDim_t);
*67e74705SXin Li};
*67e74705SXin Li
*67e74705SXin Li#define __CUDA_BUILTIN_VAR                                                     \
*67e74705SXin Li  extern const __attribute__((device)) __attribute__((weak))
*67e74705SXin Li__CUDA_BUILTIN_VAR __cuda_builtin_threadIdx_t threadIdx;
*67e74705SXin Li__CUDA_BUILTIN_VAR __cuda_builtin_blockIdx_t blockIdx;
*67e74705SXin Li__CUDA_BUILTIN_VAR __cuda_builtin_blockDim_t blockDim;
*67e74705SXin Li__CUDA_BUILTIN_VAR __cuda_builtin_gridDim_t gridDim;
*67e74705SXin Li
*67e74705SXin Li// warpSize should translate to read of %WARP_SZ but there's currently no
*67e74705SXin Li// builtin to do so. According to PTX v4.2 docs 'to date, all target
*67e74705SXin Li// architectures have a WARP_SZ value of 32'.
*67e74705SXin Li__attribute__((device)) const int warpSize = 32;
*67e74705SXin Li
*67e74705SXin Li#undef __CUDA_DEVICE_BUILTIN
*67e74705SXin Li#undef __CUDA_BUILTIN_VAR
*67e74705SXin Li#undef __CUDA_DISALLOW_BUILTINVAR_ACCESS
*67e74705SXin Li
*67e74705SXin Li#endif /* __CUDA_BUILTIN_VARS_H */