It looks like finally we have it! Time to test!!! https://github.com/ggml-org/llama.cpp/releases/tag/b8967 Platform: RTX 5090+(RTX5060TI - but not used during test) - Ryzen 9 9950X3D+128 GB DDR5 5600 CL36): TEST: CUDA_VISIBLE_DEVICES=0 /home/marcin/llama.cpp/llama-bench \ -m /home/marcin/llama.cpp_m