v0.26.dev0
Use relocated NVTX header under tvm/support/cuda and use NVTXScopedRange from tvm::support instead of tvm::runtime. Link and install tvm_runtime_extra by default so distributed runtime symbols are resolved correctly.
Use relocated NVTX header under tvm/support/cuda and use NVTXScopedRange from tvm::support instead of tvm::runtime. Link and install tvm_runtime_extra by default so distributed runtime symbols are resolved correctly.