update voice generation

This commit is contained in:
Wolfang Torres
2026-06-22 21:37:45 +08:00
parent d0c7da966d
commit 266bbbb370
3 changed files with 18 additions and 7 deletions

View File

@@ -26,9 +26,13 @@ def dictation_process(
results = []
for n, line in enumerate(text_lines):
line = line.strip()
line = " ".join(line.split())
line = line.replace("", " 。。。 ")
audio_path = process_file.resources / f"N{n:03n}.wav"
if not audio_path.exists():
audio = TTS.MODEL.generate(f"{line}", language_id=LANGUAGES.CN)
audio = TTS.MODEL.generate(
f"{line}", language_id=LANGUAGES.CN, **TTS.DEFAULTS
)
torchaudio.save(audio_path, audio, TTS.MODEL.sr)
translated = argostranslate.translate.translate(
line, LANGUAGES.CN, process_file.language_id
@@ -48,7 +52,9 @@ def translator_process(
line = line.strip()
audio_path = process_file.resources / f"N{n:03n}.wav"
if not audio_path.exists():
audio = TTS.MODEL.generate(f"{line}", language_id=LANGUAGES.CN)
audio = TTS.MODEL.generate(
f"{line}", language_id=LANGUAGES.CN, **TTS.DEFAULTS
)
torchaudio.save(audio_path, audio, TTS.MODEL.sr)
translated = argostranslate.translate.translate(
line, LANGUAGES.CN, process_file.language_id
@@ -112,7 +118,7 @@ def dictionary_process(process_file: ProcessFile) -> list[DictionaryResult]:
audio_path = process_file.resources / f"{line['pinyin']}.wav"
if not audio_path.exists():
audio = TTS.MODEL.generate(
f"{line['simplified']}", language_id=LANGUAGES.CN
f"{line['simplified']}", language_id=LANGUAGES.CN, **TTS.DEFAULTS
)
torchaudio.save(audio_path, audio, TTS.MODEL.sr)
print(line)