aboutsummaryrefslogtreecommitdiffstats
path: root/config/asistente.toml
diff options
context:
space:
mode:
Diffstat (limited to 'config/asistente.toml')
-rw-r--r--config/asistente.toml6
1 files changed, 3 insertions, 3 deletions
diff --git a/config/asistente.toml b/config/asistente.toml
index a4f7e5e..a47f5b2 100644
--- a/config/asistente.toml
+++ b/config/asistente.toml
@@ -87,7 +87,7 @@ top_p = 0.9
top_k = 40
min_p = 0.1
repeat_penalty = 1.1
-max_tokens = 300 # una respuesta hablada larga cansa, y la síntesis es lo caro
+max_tokens = 400 # una respuesta hablada larga cansa, y la síntesis es lo caro
max_tool_rounds = 4
request_timeout_secs = 120
@@ -159,7 +159,7 @@ timeout_secs = 20
# mismo modelo que conversa describe lo que capta.
[camera]
enabled = true
-device = "/dev/video0"
+device = "/dev/video2"
# La resolución manda en la latencia. Medido en esta máquina: 1,3 s a 320x240,
# 2,9 s a 640x480 y 7,8 s a 1280x720. 640x480 es el equilibrio.
width = 640
@@ -202,7 +202,7 @@ startup_timeout_secs = 180
[supervisor.llama]
binary = "../vendor/llama.cpp/build/bin/llama-server"
-model = "../models/Qwen3.5-2B.Q5_K_M.gguf"
+model = "../models/Qwen3.5-2B.Q8_0.gguf"
mmproj = "../models/mmproj-BF16.gguf"
# Copia de la plantilla del modelo con el bloque <think> cerrado de entrada.
# Sin esto el modelo razona entre 7 y 9 s antes de la primera palabra audible.