Clarify pipeline labels and default to qwen3.5 0.8b

This commit is contained in:
Adolfo Reyna
2026-03-17 00:06:47 -04:00
parent f79c4f7310
commit 4380c2ef99
5 changed files with 27 additions and 8 deletions
+1 -1
View File
@@ -17,7 +17,7 @@
"speaker_diarization": false, "speaker_diarization": false,
"post_correct": false, "post_correct": false,
"post_correct_llm": false, "post_correct_llm": false,
"post_correct_model": "qwen:2b", "post_correct_model": "qwen3.5:0.8b",
"post_correct_ollama_url": "http://127.0.0.1:11434/api/generate", "post_correct_ollama_url": "http://127.0.0.1:11434/api/generate",
"post_correct_llm_timeout": 8.0, "post_correct_llm_timeout": 8.0,
"post_correct_keep_alive": "30m", "post_correct_keep_alive": "30m",
+19 -6
View File
@@ -57,12 +57,25 @@ def run_distribution(in_queue, args):
print(msg, flush=True) print(msg, flush=True)
log_debug(msg) log_debug(msg)
# Show LLM Refinement if available bridge_text = payload.get("en_bridge")
refined = payload.get('paragraph') or payload.get('corrected') original_text = payload.get("original", "")
if refined and refined.strip() != payload.get('original', '').strip(): corrected_text = payload.get("corrected")
llm_msg = f"[LLM]: {speaker_prefix}{refined}" paragraph_text = payload.get("paragraph")
print(llm_msg, flush=True)
log_debug(llm_msg) if bridge_text and bridge_text.strip() != original_text.strip():
bridge_msg = f"[EN-BRIDGE]: {speaker_prefix}{bridge_text}"
print(bridge_msg, flush=True)
log_debug(bridge_msg)
if payload.get("used_llm_line") and corrected_text and corrected_text.strip() != bridge_text.strip():
llm_line_msg = f"[LLM-LINE]: {speaker_prefix}{corrected_text}"
print(llm_line_msg, flush=True)
log_debug(llm_line_msg)
if payload.get("used_llm_paragraph") and paragraph_text:
llm_paragraph_msg = f"[LLM-PARAGRAPH]: {speaker_prefix}{paragraph_text}"
print(llm_paragraph_msg, flush=True)
log_debug(llm_paragraph_msg)
for lang in ["es", "fr", "ar", "en"]: for lang in ["es", "fr", "ar", "en"]:
if payload.get(lang): if payload.get(lang):
+3
View File
@@ -210,6 +210,9 @@ def run_llm_processor(in_queue, out_queue, args):
"raw": raw_text, "raw": raw_text,
"corrected": corrected_text, "corrected": corrected_text,
"paragraph": structured_paragraph, "paragraph": structured_paragraph,
"en_bridge": bridge_text,
"used_llm_line": bool(getattr(args, "post_correct_llm", False)),
"used_llm_paragraph": bool(args.llm_paragraph and structured_paragraph),
"detected_lang": item.get("detected_lang"), "detected_lang": item.get("detected_lang"),
"speaker": item.get("speaker"), "speaker": item.get("speaker"),
"ts": item.get("ts", time.time()) "ts": item.get("ts", time.time())
+3
View File
@@ -74,6 +74,9 @@ def run_translation(in_queue, out_queue, args):
"original": raw_text, "original": raw_text,
"corrected": corrected_text, "corrected": corrected_text,
"paragraph": paragraph_text, "paragraph": paragraph_text,
"en_bridge": item.get("en_bridge"),
"used_llm_line": item.get("used_llm_line", False),
"used_llm_paragraph": item.get("used_llm_paragraph", False),
"speaker": item.get("speaker"), "speaker": item.get("speaker"),
"ts": item.get("ts", time.time()) "ts": item.get("ts", time.time())
} }
+1 -1
View File
@@ -49,7 +49,7 @@ def main():
# LLM Args # LLM Args
parser.add_argument("--post-correct", action="store_true", default=defaults.get("post_correct", False)) parser.add_argument("--post-correct", action="store_true", default=defaults.get("post_correct", False))
parser.add_argument("--post-correct-llm", action="store_true", default=defaults.get("post_correct_llm", False)) parser.add_argument("--post-correct-llm", action="store_true", default=defaults.get("post_correct_llm", False))
parser.add_argument("--post-correct-model", type=str, default=defaults.get("post_correct_model", "qwen:2b")) parser.add_argument("--post-correct-model", type=str, default=defaults.get("post_correct_model", "qwen3.5:0.8b"))
parser.add_argument("--post-correct-ollama-url", type=str, default=defaults.get("post_correct_ollama_url", "http://127.0.0.1:11434/api/generate")) parser.add_argument("--post-correct-ollama-url", type=str, default=defaults.get("post_correct_ollama_url", "http://127.0.0.1:11434/api/generate"))
parser.add_argument("--post-correct-llm-timeout", type=float, default=defaults.get("post_correct_llm_timeout", 8.0)) parser.add_argument("--post-correct-llm-timeout", type=float, default=defaults.get("post_correct_llm_timeout", 8.0))
parser.add_argument("--post-correct-keep-alive", type=str, default=defaults.get("post_correct_keep_alive", "30m")) parser.add_argument("--post-correct-keep-alive", type=str, default=defaults.get("post_correct_keep_alive", "30m"))