389cfa522737f9b3a7e6d6349e83ffe6971f7fcf

Author
TheEdgeOfRage <git@theedgeofrage.com>
Committer
TheEdgeOfRage <git@theedgeofrage.com>
Date

Message

Bump context size of llama models

Diff

 1diff --git a/dot_config/llama-server/models.ini b/dot_config/llama-server/models.ini
 2index c381bdcc0b1113241cadc0780fe62d1dc8b8eafc..4e52a8f5844b82a0a28fba55f07d82300335794b 100644
 3--- a/dot_config/llama-server/models.ini
 4+++ b/dot_config/llama-server/models.ini
 5@@ -23,7 +23,7 @@ alias = qwen3.6-27b
 6 n-gpu-layers = 99
 7 flash-attn = on
 8 jinja = true
 9-ctx-size = 65536
10+ctx-size = 262144
11 temp = 0.9
12 top-p = 0.95
13 top-k = 20
14@@ -39,7 +39,7 @@ hf = Jiunsong/supergemma4-26b-uncensored-gguf-v2:Q4_K_M
15 alias = supergemma4-26b
16 n-gpu-layers = 99
17 flash-attn = on
18-ctx-size = 65536
19+ctx-size = 131072
20 temp = 1.1
21 top-p = 0.95
22 top-k = 64
23@@ -53,7 +53,7 @@ n-gpu-layers = 99
24 n-gpu-layers-draft = 99
25 ngl=999
26 flash-attn = on
27-ctx-size = 65536
28+ctx-size = 131072
29 temp = 1.0
30 top-p = 0.95
31 top-k = 64