f0866da7c02afae876ce26726e6dadf8e69a1f75
- Author
- TheEdgeOfRage <git@theedgeofrage.com>
- Committer
- TheEdgeOfRage <git@theedgeofrage.com>
- Date
Message
Replace ministral 8B with qwen3.8 9B
Diff
1diff --git a/dot_config/llama-server/models.ini b/dot_config/llama-server/models.ini
2index f3d74905795e4da0ec2baa2cce2a4812f278515b..9326ec81e555b904cfa8e129ad69b1e5afa806cc 100644
3--- a/dot_config/llama-server/models.ini
4+++ b/dot_config/llama-server/models.ini
5@@ -5,14 +5,16 @@ n-gpu-layers = 99
6 ctx-size = 2048
7 embedding = true
8
9-[unsloth/Ministral-3-8B-Instruct-2512-GGUF:Q4_K_XL]
10-hf = unsloth/Ministral-3-8B-Instruct-2512-GGUF:UD-Q4_K_XL
11-alias = ministral3-8b
12+[empero-ai/Qwen3.8-9B-GGUF:Q6_K]
13+hf = empero-ai/Qwen3.8-9B-GGUF:Q6_K
14+alias = qwen3.8-9b,reviewer
15 n-gpu-layers = 99
16-ctx-size = 16384
17+ctx-size = 32768
18+n-predict = 16384
19 flash-attn = on
20 jinja = true
21 temp = 0.15
22+top-k = 20
23 parallel = 1
24
25 [unsloth/Qwen3.8-27B-GGUF:Q4_K_XL]