Clarify pipeline labels and default to qwen3.5 0.8b
This commit is contained in:
+1
-1
@@ -17,7 +17,7 @@
|
|||||||
"speaker_diarization": false,
|
"speaker_diarization": false,
|
||||||
"post_correct": false,
|
"post_correct": false,
|
||||||
"post_correct_llm": false,
|
"post_correct_llm": false,
|
||||||
"post_correct_model": "qwen:2b",
|
"post_correct_model": "qwen3.5:0.8b",
|
||||||
"post_correct_ollama_url": "http://127.0.0.1:11434/api/generate",
|
"post_correct_ollama_url": "http://127.0.0.1:11434/api/generate",
|
||||||
"post_correct_llm_timeout": 8.0,
|
"post_correct_llm_timeout": 8.0,
|
||||||
"post_correct_keep_alive": "30m",
|
"post_correct_keep_alive": "30m",
|
||||||
|
|||||||
+19
-6
@@ -57,12 +57,25 @@ def run_distribution(in_queue, args):
|
|||||||
print(msg, flush=True)
|
print(msg, flush=True)
|
||||||
log_debug(msg)
|
log_debug(msg)
|
||||||
|
|
||||||
# Show LLM Refinement if available
|
bridge_text = payload.get("en_bridge")
|
||||||
refined = payload.get('paragraph') or payload.get('corrected')
|
original_text = payload.get("original", "")
|
||||||
if refined and refined.strip() != payload.get('original', '').strip():
|
corrected_text = payload.get("corrected")
|
||||||
llm_msg = f"[LLM]: {speaker_prefix}{refined}"
|
paragraph_text = payload.get("paragraph")
|
||||||
print(llm_msg, flush=True)
|
|
||||||
log_debug(llm_msg)
|
if bridge_text and bridge_text.strip() != original_text.strip():
|
||||||
|
bridge_msg = f"[EN-BRIDGE]: {speaker_prefix}{bridge_text}"
|
||||||
|
print(bridge_msg, flush=True)
|
||||||
|
log_debug(bridge_msg)
|
||||||
|
|
||||||
|
if payload.get("used_llm_line") and corrected_text and corrected_text.strip() != bridge_text.strip():
|
||||||
|
llm_line_msg = f"[LLM-LINE]: {speaker_prefix}{corrected_text}"
|
||||||
|
print(llm_line_msg, flush=True)
|
||||||
|
log_debug(llm_line_msg)
|
||||||
|
|
||||||
|
if payload.get("used_llm_paragraph") and paragraph_text:
|
||||||
|
llm_paragraph_msg = f"[LLM-PARAGRAPH]: {speaker_prefix}{paragraph_text}"
|
||||||
|
print(llm_paragraph_msg, flush=True)
|
||||||
|
log_debug(llm_paragraph_msg)
|
||||||
|
|
||||||
for lang in ["es", "fr", "ar", "en"]:
|
for lang in ["es", "fr", "ar", "en"]:
|
||||||
if payload.get(lang):
|
if payload.get(lang):
|
||||||
|
|||||||
@@ -210,6 +210,9 @@ def run_llm_processor(in_queue, out_queue, args):
|
|||||||
"raw": raw_text,
|
"raw": raw_text,
|
||||||
"corrected": corrected_text,
|
"corrected": corrected_text,
|
||||||
"paragraph": structured_paragraph,
|
"paragraph": structured_paragraph,
|
||||||
|
"en_bridge": bridge_text,
|
||||||
|
"used_llm_line": bool(getattr(args, "post_correct_llm", False)),
|
||||||
|
"used_llm_paragraph": bool(args.llm_paragraph and structured_paragraph),
|
||||||
"detected_lang": item.get("detected_lang"),
|
"detected_lang": item.get("detected_lang"),
|
||||||
"speaker": item.get("speaker"),
|
"speaker": item.get("speaker"),
|
||||||
"ts": item.get("ts", time.time())
|
"ts": item.get("ts", time.time())
|
||||||
|
|||||||
@@ -74,6 +74,9 @@ def run_translation(in_queue, out_queue, args):
|
|||||||
"original": raw_text,
|
"original": raw_text,
|
||||||
"corrected": corrected_text,
|
"corrected": corrected_text,
|
||||||
"paragraph": paragraph_text,
|
"paragraph": paragraph_text,
|
||||||
|
"en_bridge": item.get("en_bridge"),
|
||||||
|
"used_llm_line": item.get("used_llm_line", False),
|
||||||
|
"used_llm_paragraph": item.get("used_llm_paragraph", False),
|
||||||
"speaker": item.get("speaker"),
|
"speaker": item.get("speaker"),
|
||||||
"ts": item.get("ts", time.time())
|
"ts": item.get("ts", time.time())
|
||||||
}
|
}
|
||||||
|
|||||||
+1
-1
@@ -49,7 +49,7 @@ def main():
|
|||||||
# LLM Args
|
# LLM Args
|
||||||
parser.add_argument("--post-correct", action="store_true", default=defaults.get("post_correct", False))
|
parser.add_argument("--post-correct", action="store_true", default=defaults.get("post_correct", False))
|
||||||
parser.add_argument("--post-correct-llm", action="store_true", default=defaults.get("post_correct_llm", False))
|
parser.add_argument("--post-correct-llm", action="store_true", default=defaults.get("post_correct_llm", False))
|
||||||
parser.add_argument("--post-correct-model", type=str, default=defaults.get("post_correct_model", "qwen:2b"))
|
parser.add_argument("--post-correct-model", type=str, default=defaults.get("post_correct_model", "qwen3.5:0.8b"))
|
||||||
parser.add_argument("--post-correct-ollama-url", type=str, default=defaults.get("post_correct_ollama_url", "http://127.0.0.1:11434/api/generate"))
|
parser.add_argument("--post-correct-ollama-url", type=str, default=defaults.get("post_correct_ollama_url", "http://127.0.0.1:11434/api/generate"))
|
||||||
parser.add_argument("--post-correct-llm-timeout", type=float, default=defaults.get("post_correct_llm_timeout", 8.0))
|
parser.add_argument("--post-correct-llm-timeout", type=float, default=defaults.get("post_correct_llm_timeout", 8.0))
|
||||||
parser.add_argument("--post-correct-keep-alive", type=str, default=defaults.get("post_correct_keep_alive", "30m"))
|
parser.add_argument("--post-correct-keep-alive", type=str, default=defaults.get("post_correct_keep_alive", "30m"))
|
||||||
|
|||||||
Reference in New Issue
Block a user