f0866da7c02afae876ce26726e6dadf8e69a1f75

Author
TheEdgeOfRage <git@theedgeofrage.com>
Committer
TheEdgeOfRage <git@theedgeofrage.com>
Date

Message

Replace ministral 8B with qwen3.8 9B

Diff

 1diff --git a/dot_config/llama-server/models.ini b/dot_config/llama-server/models.ini
 2index f3d74905795e4da0ec2baa2cce2a4812f278515b..9326ec81e555b904cfa8e129ad69b1e5afa806cc 100644
 3--- a/dot_config/llama-server/models.ini
 4+++ b/dot_config/llama-server/models.ini
 5@@ -5,14 +5,16 @@ n-gpu-layers = 99
 6 ctx-size = 2048
 7 embedding = true
 8 
 9-[unsloth/Ministral-3-8B-Instruct-2512-GGUF:Q4_K_XL]
10-hf = unsloth/Ministral-3-8B-Instruct-2512-GGUF:UD-Q4_K_XL
11-alias = ministral3-8b
12+[empero-ai/Qwen3.8-9B-GGUF:Q6_K]
13+hf = empero-ai/Qwen3.8-9B-GGUF:Q6_K
14+alias = qwen3.8-9b,reviewer
15 n-gpu-layers = 99
16-ctx-size = 16384
17+ctx-size = 32768
18+n-predict = 16384
19 flash-attn = on
20 jinja = true
21 temp = 0.15
22+top-k = 20
23 parallel = 1
24 
25 [unsloth/Qwen3.8-27B-GGUF:Q4_K_XL]