
Vulkan Tensor Parallel support improvements in llama.cpp
A new pull request aims to make Tensor Parallelism viable when using the Vulkan backend in llama.cpp. This update is a significant step toward improving multi-GPU performance for non-Nvidia hardware.



