Compare commits

..

2 Commits

Author SHA1 Message Date
Wolfang Torres
df64a5fc15 update voice generation 2026-06-24 22:12:50 +08:00
Wolfang Torres
2cf2a1a5a9 update voice generation 2026-06-24 22:12:17 +08:00

View File

@@ -27,12 +27,12 @@ def dictation_process(
for n, line in enumerate(text_lines):
line = line.strip()
line = " ".join(line.split())
audio_line = f"[pause:{WORD}s]".join(line)
audio_line = audio_line.replace("", f"[pause:{COMMA}s]")
audio_line = " ".join(line)
audio_line = audio_line.replace("", "。。。]")
audio_path = process_file.resources / f"N{n:03n}.wav"
if not audio_path.exists():
audio = TTS.MODEL.generate(
f"{line}", language_id=LANGUAGES.CN, **TTS.DEFAULTS
f"{audio_line}", language_id=LANGUAGES.CN, **TTS.DEFAULTS
)
torchaudio.save(audio_path, audio, TTS.MODEL.sr)
translated = argostranslate.translate.translate(
@@ -52,8 +52,8 @@ def translator_process(
for n, line in enumerate(text_lines):
line = line.strip()
line = " ".join(line.split())
audio_line = "[pause:0.1s]".join(line)
audio_line = audio_line.replace("", "[pause:0.5s]")
audio_line = " ".join(line)
audio_line = audio_line.replace("", "。。。]")
audio_path = process_file.resources / f"N{n:03n}.wav"
if not audio_path.exists():
audio = TTS.MODEL.generate(