Skip to content

Commit d9c5e54

Browse files
committed
keep printing out of kcpp_backend
1 parent a8cc444 commit d9c5e54

3 files changed

Lines changed: 6 additions & 8 deletions

File tree

gpttype_adapter.cpp

Lines changed: 5 additions & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -3215,7 +3215,11 @@ ModelLoadResult gpttype_load_model(const load_model_inputs inputs, FileFormat in
32153215
printf("Main GPU device: Try set to %d\n",kcpp_parseinfo_maindevice);
32163216
}
32173217

3218-
kcpp_backend_cuda_set_mul_mat_q(inputs.use_mmq);
3218+
if(kcpp_backend_check(KCPP_BACKENDS_USE_CUDA)) {
3219+
printf("CUDA MMQ: %s\n",(inputs.use_mmq?"True":"False"));
3220+
printf("---\nInitializing CUDA/HIP, please wait, the following step may take a few minutes (only for first launch)...\n---\n");
3221+
kcpp_backend_cuda_set_mul_mat_q(inputs.use_mmq);
3222+
}
32193223

32203224
model_params.main_gpu = kcpp_parseinfo_maindevice;
32213225
model_params.split_mode = (inputs.splitmode>0?((llama_split_mode)(inputs.splitmode)):llama_split_mode::LLAMA_SPLIT_MODE_LAYER);

kcpp_backend.cpp

Lines changed: 0 additions & 7 deletions
Original file line numberDiff line numberDiff line change
@@ -141,7 +141,6 @@ void kcpp_backend_cuda_ggmlv2_transform_tensor(ggml_v2_tensor * tensor)
141141
void kcpp_backend_cuda_ggmlv3_set_main_device(int device)
142142
{
143143
#if defined(GGML_USE_CUDA)
144-
printf("CUBLAS v3: Set main device to %d\n",device);
145144
ggml_v3_cuda_set_main_device(device);
146145
#endif
147146
}
@@ -212,8 +211,6 @@ void kcpp_backend_cuda_ggmlv3_set_scratch_size(size_t scratch_size)
212211
void kcpp_backend_cuda_set_mul_mat_q(int use_mmq)
213212
{
214213
#if defined(GGML_USE_CUDA)
215-
printf("CUDA MMQ: %s\n",(use_mmq?"True":"False"));
216-
printf("---\nInitializing CUDA/HIP, please wait, the following step may take a few minutes (only for first launch)...\n---\n");
217214
ggml_cuda_set_mul_mat_q(use_mmq);
218215
#endif
219216
}
@@ -225,7 +222,3 @@ void kcpp_backend_hip_initialize()
225222
#endif
226223
}
227224

228-
229-
230-
231-

otherarch/llama_v3.cpp

Lines changed: 1 addition & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -1162,6 +1162,7 @@ static void llama_v3_model_load_internal(
11621162

11631163
if (kcpp_backend_check(KCPP_BACKENDS_USE_CUDA)) {
11641164
LLAMA_V3_LOG_INFO("%s: using CUDA for GPU acceleration\n", __func__);
1165+
printf("CUBLAS v3: Set main device to %d\n",main_gpu);
11651166
kcpp_backend_cuda_ggmlv3_set_main_device(main_gpu);
11661167
kcpp_backend_cuda_ggmlv3_set_mul_mat_q(mul_mat_q);
11671168
LLAMA_V3_BACKEND_OFFLOAD = GGML_V3_BACKEND_GPU;

0 commit comments

Comments
 (0)