forked from ggml-org/llama.cpp
-
Notifications
You must be signed in to change notification settings - Fork 18
Expand file tree
/
Copy pathSCRIPT_llama_bench2.sh
More file actions
executable file
·57 lines (44 loc) · 3.13 KB
/
Copy pathSCRIPT_llama_bench2.sh
File metadata and controls
executable file
·57 lines (44 loc) · 3.13 KB
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
#!/bin/bash
cat << 'EOF'
██╗ ██╗ █████╗ ███╗ ███╗ █████╗ ██████╗██████╗ ██████╗
██║ ██║ ██╔══██╗████╗ ████║██╔══██╗ ██╔════╝██╔══██╗██╔══██╗
██║ ██║ ███████║██╔████╔██║███████║ ██║ ██████╔╝██████╔╝
██║ ██║ ██╔══██║██║╚██╔╝██║██╔══██║ ██║ ██╔═══╝ ██╔═══╝
███████╗███████╗██║ ██║██║ ╚═╝ ██║██║ ██║ ╚██████╗██║ ██║
╚══════╝╚══════╝╚═╝ ╚═╝╚═╝ ╚═╝╚═╝ ╚═╝ ╚═════╝╚═╝ ╚═╝
██████╗ ███████╗██╗ ██╗ █████╗ ██████╗ ██████╗
██╔════╝ ██╔════╝╚██╗██╔╝██╔══██╗██╔═████╗██╔════╝
██║ ███╗█████╗ ╚███╔╝ ╚██████║██║██╔██║███████╗
██║ ██║██╔══╝ ██╔██╗ ╚═══██║████╔╝██║██╔═══██╗
╚██████╔╝██║ ██╔╝ ██╗ █████╔╝╚██████╔╝╚██████╔╝
╚═════╝ ╚═╝ ╚═╝ ╚═╝ ╚════╝ ╚═════╝ ╚═════╝
EOF
export HSA_OVERRIDE_GFX_VERSION=9.0.6
export HIP_VISIBLE_DEVICES=0
MODEL_PATH="/media/iacoppbk/80F42C9BF42C96061/llms/Qwen3-VL-30B-A3B-Thinking-Q4_1.gguf"
LOG_FILE="bench_results.md"
BENCH_PARAMS=(
-m "$MODEL_PATH" # Model path
-ngl 99 # Number of GPU layers (all on GPU)
-t "$(nproc)" # Number of CPU threads
-fa 1 # Flash attention (1=on, 0=off)
-ctk q8_0 # KV cache key type (q8_0 quantization)
-ctv f16 # KV cache value type (f16 precision)
--main-gpu 0 # Main GPU device ID
--progress # Show progress during benchmark
-r 1 # Number of repetitions
-b 2048 # Batch size
-ub 2048 # Micro-batch size
#-d 8192 # Context size
)
#BENCH_TESTS="-p 0 -n 2048"
#BENCH_TESTS="-p 2048 -n 0"
BENCH_TESTS="-p 512 -n 1,128,2048"
echo "=== Benchmark ==="
echo "Model: $(basename "$MODEL_PATH")"
echo ""
cd "$(dirname "$0")" || exit
[ ! -f "./build/bin/llama-bench" ] && echo "Error: llama-bench not found" && exit 1
./build/bin/llama-bench "${BENCH_PARAMS[@]}" "$BENCH_TESTS" "$@" 2>&1 | tee -a "$LOG_FILE"
echo ""
echo "Output saved to: $LOG_FILE"