b16210928d9a1a84e0d67316cbd8f585bf76ebe1

Author
TheEdgeOfRage <git@theedgeofrage.com>
Committer
TheEdgeOfRage <git@theedgeofrage.com>
Date

Message

Add F2LLM embedding model to llama

Diff

 1diff --git a/dot_config/llama-server/models.ini b/dot_config/llama-server/models.ini
 2index df278966f9947b2200197c47ba61b549ad026103..89430b6ceae31f4cf13996dae8531a271a538f35 100644
 3--- a/dot_config/llama-server/models.ini
 4+++ b/dot_config/llama-server/models.ini
 5@@ -5,6 +5,12 @@ n-gpu-layers = 99
 6 ctx-size = 2048
 7 embedding = true
 8 
 9+[F2LLM-v2-330M-GGUF:Q8_0]
10+model = /home/pavle/.local/share/llama-server/models/f2llm-v2-330m-q8_0.gguf
11+alias = f2llm-v2-330m
12+n-gpu-layers = 99
13+embedding = true
14+
15 [empero-ai/Qwen3.8-9B-GGUF:Q6_K]
16 hf = empero-ai/Qwen3.8-9B-GGUF:Q6_K
17 alias = qwen3.8-9b,reviewer