HIP: Prepare reduction operators for wave 64

2025-08-11 11:05:39 -04:00 · 2025-01-29 19:12:42 +01:00
parent c300e68ef4
commit 6af1ca48cb
2 changed files with 28 additions and 35 deletions
--- a/ggml/src/ggml-cuda/ggml-cuda.cu
+++ b/ggml/src/ggml-cuda/ggml-cuda.cu
@@ -240,8 +240,8 @@ static ggml_cuda_device_info ggml_cuda_init() {
        info.default_tensor_split[id] = total_vram;
        total_vram += prop.totalGlobalMem;

-        info.devices[id].nsm   = prop.multiProcessorCount;
-        info.devices[id].smpb  = prop.sharedMemPerBlock;
+        info.devices[id].nsm       = prop.multiProcessorCount;
+        info.devices[id].smpb      = prop.sharedMemPerBlock;
        info.devices[id].warp_size = prop.warpSize;
 #if defined(GGML_USE_HIP) && defined(__HIP_PLATFORM_AMD__)
        info.devices[id].smpbo = prop.sharedMemPerBlock;