Warm up local LLM before live corrections

This commit is contained in:
Adolfo Reyna
2026-03-17 00:29:20 -04:00
parent 9d9ee03ca1
commit 0dcbef7d34
3 changed files with 28 additions and 0 deletions
+1
View File
@@ -53,6 +53,7 @@ def main():
parser.add_argument("--post-correct-ollama-url", type=str, default=defaults.get("post_correct_ollama_url", "http://127.0.0.1:11434/api/generate"))
parser.add_argument("--post-correct-llm-timeout", type=float, default=defaults.get("post_correct_llm_timeout", 8.0))
parser.add_argument("--post-correct-keep-alive", type=str, default=defaults.get("post_correct_keep_alive", "30m"))
parser.add_argument("--post-correct-warmup-timeout", type=float, default=defaults.get("post_correct_warmup_timeout", 20.0))
parser.add_argument("--post-correct-min-overlap", type=float, default=defaults.get("post_correct_min_overlap", 0.45))
parser.add_argument("--post-correct-debug", action="store_true", default=defaults.get("post_correct_debug", False))
parser.add_argument("--llm-paragraph", action="store_true", default=defaults.get("llm_paragraph", False))