diff options
Diffstat (limited to 'config/asistente.toml')
| -rw-r--r-- | config/asistente.toml | 6 |
1 files changed, 3 insertions, 3 deletions
diff --git a/config/asistente.toml b/config/asistente.toml index a4f7e5e..a47f5b2 100644 --- a/config/asistente.toml +++ b/config/asistente.toml @@ -87,7 +87,7 @@ top_p = 0.9 top_k = 40 min_p = 0.1 repeat_penalty = 1.1 -max_tokens = 300 # una respuesta hablada larga cansa, y la síntesis es lo caro +max_tokens = 400 # una respuesta hablada larga cansa, y la síntesis es lo caro max_tool_rounds = 4 request_timeout_secs = 120 @@ -159,7 +159,7 @@ timeout_secs = 20 # mismo modelo que conversa describe lo que capta. [camera] enabled = true -device = "/dev/video0" +device = "/dev/video2" # La resolución manda en la latencia. Medido en esta máquina: 1,3 s a 320x240, # 2,9 s a 640x480 y 7,8 s a 1280x720. 640x480 es el equilibrio. width = 640 @@ -202,7 +202,7 @@ startup_timeout_secs = 180 [supervisor.llama] binary = "../vendor/llama.cpp/build/bin/llama-server" -model = "../models/Qwen3.5-2B.Q5_K_M.gguf" +model = "../models/Qwen3.5-2B.Q8_0.gguf" mmproj = "../models/mmproj-BF16.gguf" # Copia de la plantilla del modelo con el bloque <think> cerrado de entrada. # Sin esto el modelo razona entre 7 y 9 s antes de la primera palabra audible. |