b16210928d9a1a84e0d67316cbd8f585bf76ebe1
- Author
- TheEdgeOfRage <git@theedgeofrage.com>
- Committer
- TheEdgeOfRage <git@theedgeofrage.com>
- Date
Message
Add F2LLM embedding model to llama
Diff
1diff --git a/dot_config/llama-server/models.ini b/dot_config/llama-server/models.ini
2index df278966f9947b2200197c47ba61b549ad026103..89430b6ceae31f4cf13996dae8531a271a538f35 100644
3--- a/dot_config/llama-server/models.ini
4+++ b/dot_config/llama-server/models.ini
5@@ -5,6 +5,12 @@ n-gpu-layers = 99
6 ctx-size = 2048
7 embedding = true
8
9+[F2LLM-v2-330M-GGUF:Q8_0]
10+model = /home/pavle/.local/share/llama-server/models/f2llm-v2-330m-q8_0.gguf
11+alias = f2llm-v2-330m
12+n-gpu-layers = 99
13+embedding = true
14+
15 [empero-ai/Qwen3.8-9B-GGUF:Q6_K]
16 hf = empero-ai/Qwen3.8-9B-GGUF:Q6_K
17 alias = qwen3.8-9b,reviewer