soundWave
soundWave je doplnok pre NVDA, ktorý renderuje text do zvukového súboru pomocou nainštalovaných rečových enginov.
Dokáže exportovať zvuk z textu v schránke, z textového súboru, z priečinka textových súborov alebo z textu zadaného priamo v doplnku.
Rýchly začiatok
- Stlačte NVDA+Ctrl+=, aby ste otvorili soundWave.
- Vyberte syntetizér.
- Voliteľne nastavte základný priečinok nahrávok. Je to predvolený priečinok na ukladanie renderov; soundWave v ňom vytvára výstupné priečinky podľa vašich šablón pomenovania.
- Vyberte zdroj vstupu: schránku, textový súbor, priečinok textových súborov alebo ručne zadaný či prilepený text.
- Nakonfigurujte syntetizér. Tlačidlom Testovať si vypočujte krátku ukážku aktuálnych nastavení.
- Vyberte názov výstupného súboru a formát.
- Počkajte na dokončenie renderovania a potom si pozrite súhrn.
V dialógoch renderovania soundWave stlačte F1, aby ste otvorili túto príručku.
V paneli soundWave v nastaveniach NVDA prejdite klávesom Tab na tlačidlo Pomocník alebo použite skratku Alt+H.
Ovládacie prvky dialógov majú klávesové skratky tam, kde je to praktické, napríklad Alt+T pre tlačidlo Testovať.
Vstup a výstup
- Vstup: text zo schránky, textový súbor, priečinok textových súborov alebo ručne zadaný či prilepený text.
- Výstup: WAV je podporovaný vždy. MP3, FLAC a M4A sú dostupné, keď je ffmpeg nainštalovaný a dostupný v systémovej premennej PATH.
- Dávkový vstup: výber priečinka vyrenderuje každý čitateľný textový súbor ako samostatný zvukový súbor v zoradenom poradí. Dávkové renderovanie sa predvolene ukladá do podpriečinka syntetizéra a hlasu a názvy súborov dostanú poradové čísla.
- Dlhé vstupy: dlhý text sa renderuje po častiach. Ak by jeden súbor WAV bol príliš veľký, soundWave zapíše očíslované časti.
- Priečinky a názvy súborov: soundWave môže samostatne pomenovať priečinky jedného renderovania, jednotlivé súbory, dávkové priečinky a dávkové súbory.
- Názvy hlasov: keď soundWave dokáže rozpoznať vybraný hlas, môže ho zahrnúť do šablón priečinkov alebo súborov, aby sa rendery toho istého vstupu s rôznymi syntetizérmi alebo hlasmi dali ľahšie rozlíšiť.
Priebeh renderovania
Počas renderovania soundWave zobrazuje dialóg priebehu s tlačidlom Zrušiť a voliteľnými podrobnosťami po riadkoch.
Tlačidlom Zobraziť podrobnosti môžete skontrolovať aktuálny súbor, časť textu, uplynulý čas, dĺžku vyrenderovaného zvuku a rýchlosť konverzie, ak sú tieto údaje dostupné.
Dlhé trvania sa zobrazujú v minútach alebo hodinách, nie iba ako počet sekúnd.
Pri dlhých renderoch použite tlačidlo Minimalizovať alebo skratku Alt+M, aby ste skryli dialóg priebehu.
Renderovanie pokračuje na pozadí a skrytý dialóg nezostáva v zozname Alt+Tab.
Opätovným stlačením príkazu soundWave, NVDA+Ctrl+=, vrátite aktívny dialóg priebehu.
Ak je už otvorený iný dialóg soundWave, rovnaký príkaz ho prenesie do popredia namiesto otvorenia ďalšieho procesu renderovania.
Nastavenia
Otvorte nastavenia NVDA a vyberte kategóriu soundWave, aby ste nastavili predvoľby pre budúce rendery.
- Predvolený priečinok uloženia: základný priečinok nahrávok používaný v prvom dialógu soundWave. Ak ho ponecháte prázdny, použije sa Dokumenty\SoundWave, takže vyrenderované súbory zostanú na mieste, ktoré väčšina používateľov ľahko nájde.
- Pomenovanie priečinkov a súborov: samostatné šablóny riadia priečinky jedného renderovania, jednotlivé súbory, dávkové priečinky a dávkové súbory. Tabuľky nižšie ukazujú predvolené hodnoty, značky a príklady.
- Predvolený výstupný formát: vyberte WAV alebo MP3, FLAC či M4A, keď je dostupný ffmpeg. Voliteľné začiarkavacie políčka umožňujú preskočiť dialóg Uložiť ako pre jedno renderovanie a výber formátu pre dávku.
- Dodatočné spracovanie výšky: voliteľne použije zmenu výšky v štýle Sonic po tom, ako syntetizátor vyrenderuje zvuk. Výška Sonic používa škálu od 0 do 100, pričom hodnota 50 znamená bez zmeny. Nižšie hodnoty znižujú výšku výsledného súboru a vyššie ju zvyšujú. Celý rozsah zodpovedá približne -12 až +12 poltónom a vyžaduje ffmpeg s podporou rubberband.
- Po renderovaní: vyberte, či má soundWave po dokončení celého renderovania otvoriť výstupný priečinok, otvoriť zvuk v predvolenom prehrávači médií alebo zobraziť súhrn renderovania. Automatické prehratie dávky otvorí vyrenderované súbory ako zoznam prehrávania. Automatické otvorenie priečinka znovu neotvorí priečinok, ktorý už soundWave otvoril v aktuálnej relácii NVDA.
Šablóny názvov
Polia názvov sú šablóny. soundWave pred navrhnutím priečinka alebo názvu súboru nahradí každú značku informáciami z aktuálneho renderovania.
Značky môžete odstrániť, presunúť, pridať vlastné slová alebo zmeniť interpunkciu medzi nimi.
| Nastavenie | Predvolené | Príklad výstupu | Čo ovláda |
| Vzor priečinka jedného renderovania |
%engine% - %voice% |
Sonata - Kirsten Two En Medium |
Priečinok ponúknutý dialógom Uložiť ako pre schránku, ručne zadaný text alebo jeden textový súbor. |
| Vzor názvu jedného súboru |
%source% |
Schránka.wav |
Navrhovaný názov súboru pre jedno renderovanie. |
| Vzor dávkového priečinka |
%engine% - %voice% |
Keynote Gold - Fred |
Výstupný priečinok vytvorený pri renderovaní priečinka textových súborov. |
| Vzor dávkového súboru |
%number% - %source% |
03 - tretia kapitola.wav |
Názov každého vyrenderovaného súboru v dávke. |
Príklady pomenovania
| Vzor | Príklad výstupu | Kedy je užitočný |
%engine% - %voice% |
Orpheus - Synthetic Dave |
Zoskupuje výstup podľa syntetizéra a hlasu. |
%source% - %engine% |
prvá kapitola - SAPI5.wav |
Ponechá zdroj na začiatku, ale stále označí syntetizér. |
%number% - %source% |
01 - úvodné titulky.wav |
Udržiava výstup dávky v predvídateľnom poradí. |
Význam značiek názvu súboru
| Značka | Význam | Príklad hodnoty |
%source% |
Schránka, zadaný text, názov zdrojového súboru alebo názov položky zo zdrojového priečinka. |
Schránka, Zadaný text, prvá kapitola alebo poznámky zo stretnutia |
%engine% |
Názov syntetizéra. |
Orpheus, Sonata, SAPI5 alebo Pocket TTS |
%voice% |
Vybraný hlas, keď ho soundWave dokáže rozpoznať. Ak hlas nie je známy, táto časť sa čisto odstráni. |
Synthetic Dave, Kirsten Two En Medium alebo Fred |
%number% |
Poradové číslo. Renderovanie priečinka ho pridáva automaticky; značka je dostupná aj pre vlastné vzory pomenovania. |
01, 02 alebo 03 |
Možnosti syntetizátorov
Syntetizátory sprístupňujú nastavenia ako hlas, jazyk, variant, rýchlosť, tempo, výška alebo hlasitosť tam, kde sú tieto možnosti dostupné.
Väčšina dialógov nastavení obsahuje:
- Automaticky prehrať pri zmene nastavení na automatický náhľad zmien.
- Testovať na prehratie krátkej ukážky s aktuálnymi nastaveniami.
- Trvalé nastavenia uložené v konfigurácii NVDA.
Podporované syntetizátory
| Syntetizér | Poznámky |
| SAPI5 |
Používa nainštalované hlasy Microsoft SAPI5. 32-bitové hlasy SAPI5 sú podporované samostatnou 32-bitovou pomocnou cestou, keď je dostupná. V dialógu renderovania možno nastaviť tempo, výšku a hlasitosť SAPI5. soundWave sa pýta SAPI na predvolený výstupný formát vybraného hlasu namiesto vynucovania pevnej vzorkovacej frekvencie; ak SAPI formát neposkytne, použije sa záložný formát 22,05 kHz 16-bit mono. |
| googleTtsForNvda |
Vyžaduje doplnok Google TTS For NVDA a nainštalované balíky hlasov Google. soundWave pri renderovaní priamo zachytáva PCM zvuk generovaný doplnkom. Tlačidlo Testovať vyrenderuje krátku ukážku do dočasného WAV súboru a prehrá ju, takže nepoužíva živú reč NVDA. soundWave zobrazuje iba hlasy Google, ktoré sú nainštalované a spoľahlivé v tejto offline renderovacej ceste, takže zoznam môže byť kratší ako úplný katalóg hlasov doplnku Google. |
| Pocket TTS |
Vyžaduje doplnok Pocket TTS. soundWave podľa potreby renderuje v menších segmentoch, aby dlhší text menej často narazil na limity modelu. Ak model narazí na známu chybu stavu transformera s nulovou dĺžkou, soundWave bezpečne zopakuje iba daný segment v menších častiach bez zachovania čiastočného zvuku. Dialóg možností obsahuje nastavenia citlivosti konca vety a krokov toku Pocket TTS, ak ich nainštalovaný syntetizér sprístupňuje. Kroky toku určujú počet prechodov spresnenia modelu od 1 do 10; 10 je predvolená hodnota plnej kvality, zatiaľ čo nižšie hodnoty môžu renderovať rýchlejšie s menej stabilnou rečou. |
| Supertonic |
Vyžaduje doplnok Supertonic. soundWave používa pre Supertonic menšie časti renderovania, aby sa dlhší vstup dal vyrenderovať bez prekročenia limitu veľkosti vstupu modelu. |
| Sonata |
Vyžaduje doplnok Sonata Neural Voices a dostupné konfiguračné súbory hlasov. |
| Eloquence a IBMTTS |
Dostupné, keď je nainštalovaný príslušný doplnok NVDA. soundWave automaticky zistí rečový engine a pred renderovaním ponúkne možnosti hlasu a rýchlosti. |
| Orpheus |
Vyžaduje, aby bol Orpheus aktuálnym syntetizérom NVDA pred začatím renderovania. Pred renderovaním možno nastaviť jazyk, hlas, rýchlosť, výšku a hlasitosť. Počas renderovania soundWave dočasne prepne NVDA na dostupný záložný syntetizér. |
| Orpheus Classic |
Dostupný, keď je nainštalovaný doplnok Orpheus Classic. soundWave používa pre tento starší syntetizér vyhradenú zachytávaciu cestu, aby dlhšie pauzy a interpunkcia nespôsobovali skrátený výstup. |
| Prose 2000 |
Dostupný, keď je nainštalovaný doplnok Prose 2000. soundWave renderuje cez nezávislého hostiteľa Prose namiesto zachytávania globálneho zvukového výstupu NVDA. Tempo, zosilnenie tempa a hlasitosť sa použijú bez zmeny aktívneho syntetizátora NVDA. |
| DECtalk a Keynote Gold |
Dostupné, keď je požadovaný doplnok nainštalovaný a zistiteľný. Keynote Gold v dialógu renderovania sprístupňuje jazyk, hlas, rýchlosť, výšku, hlasitosť a zrýchlenie tempa. Kódovanie, vzorkovacia frekvencia, spracovanie čísel a nastavenia enginu špecifické pre jazyk poskytuje nainštalovaný doplnok BestSpeech. |
| Iné syntetizátory NVDA |
soundWave dokáže renderovať mnoho ďalších nainštalovaných syntetizátorov NVDA, keď používajú bežnú zvukovú výstupnú cestu NVDA. Všeobecný dialóg použije jazyk, hlas, variant, tempo, výšku a hlasitosť tam, kde ich vybraný syntetizér sprístupňuje. Syntetizátory, v ktorých je jazyk úplne určený výberom hlasu, nezobrazujú nadbytočný výber jazyka. |
Súhrn renderovania
Po renderovaní soundWave oznámi syntetizér, uloženú cestu, uplynulý čas, dĺžku zvuku a faktor rýchlosti voči reálnemu času, ak je dostupný.
Aktualizácie
soundWave používa aktualizačný kanál doplnkov NVDA kompatibilný s distribúciou cez Add-on Store.
Zmeny
1.2.5
- Opravený konflikt názvu prekladu, ktorý bránil otvoreniu dialógu možností Sonata.
- Zabránené hromadeniu viacerých procesov renderovania a dialógov súhrnu soundWave.
- Príkaz soundWave teraz prenesie existujúci dialóg do popredia, keď je už proces otvorený.
- Súhrn renderovania sa teraz vráti do popredia po automatickom otvorení výstupného priečinka.
1.2.4
- Pridaný výber jazyka pre Keynote Gold/BestSpeech a všeobecné syntetizátory NVDA, ktoré sprístupňujú nastavenie jazyka.
- Do možností renderovania bolo pridané natívne nastavenie kvality Kroky toku Pocket TTS v rozsahu od 1 do 10.
- Renderovanie BestSpeech teraz používa vlastnú jazykovo uvedomelú rečovú cestu nainštalovaného ovládača vrátane jeho kódovania, vzorkovacej frekvencie, spracovania čísel a nastavení enginu.
- Dlhé renderovanie Pocket TTS sa bezpečne zotaví zo známej chyby stavu transformera s nulovou dĺžkou tak, že zopakuje iba dotknutý segment v menších častiach bez zachovania čiastočného zvuku.
- Poľský a slovenský katalóg rozhrania a príručky boli aktualizované spolu s anglickými zmenami.
1.2.3
- Renderovanie Prose 2000 teraz používa natívne nastavenia rýchlosti, výšky a hlasitosti firmvéru syntetizátora.
- Z dialógu možností Prose 2000 boli odstránené neaktívne voľby Hlas a Variant.
- Predchádzajúca cesta renderovania Prose zostala zachovaná ako režim kompatibility pre staršie inštalácie Prose.
1.2.2
- Aktualizované poľské a slovenské preklady rozhrania a príručky na základe hlásenia #11 od Kazimierza Parzycha a DJ Graca.
- Pridané automatické generovanie aktuálnej prekladovej šablóny
soundWave.pot pre každé vydanie na GitHube.
- Uzatvára hlásenie #11.
1.2.1
- Pridaný samostatný mechanizmus renderovania Prose 2000 využívajúci jeho izolovaného natívneho hostiteľa.
- Testovanie hlasu Prose a výsledné renderovanie boli oddelené od všeobecného zachytávania zvuku NVDA v soundWave, čím sa predchádza konfliktom s inými zvukovými doplnkami.
- V možnostiach Prose v soundWave bola popri tempe a hlasitosti pridaná podpora zosilnenia tempa.
1.2.0
- Pridané voliteľné spracovanie výšky po renderovaní. Používa sa na dokončený zvuk WAV pred vytvorením konečného výstupu WAV, MP3, FLAC alebo M4A, takže existujúce cesty renderovania syntetizátorov zostávajú nezmenené. Nastavenie je predvolene vypnuté, používa škálu výšky Sonic od 0 do 100 a celý rozsah zodpovedá približne -12 až +12 poltónom.
- Pridaná poľská a slovenská lokalizácia rozhrania na základe #10 od Kazimierza Parzycha a DJ Graca.
- Pridaná poľská a slovenská príručka na základe #9 od Kazimierza Parzycha.
- Pred začiatkom renderovania bola pridaná kontrola možnosti zápisu do výstupného priečinka, takže nedostupné alebo poškodené priečinky rýchlo vyvolajú zrozumiteľnú chybu soundWave namiesto toho, aby renderovanie najprv prebehlo a zlyhalo až pri konečnej konverzii.
- Uzatvára #7.
- Uzatvára #8.
1.1.2
- Pridaná vyhradená cesta zachytávania Orpheus Classic. soundWave teraz renderuje Orpheus Classic cez bežný tok ovládača NVDA a priamo zachytáva generovaný zvuk, čím sa predchádza veľmi krátkemu výstupu, ktorý sa mohol objaviť pri všeobecnom zachytávaní NVDA.
- Vylepšené renderovanie Orpheus Classic pri väčších interpunkčných pauzách vrátane riadkov s výkričníkmi a dlhších páuz v príspevkoch podobných Mastodonu.
1.1.1
- Vylepšené dlhé rendery googleTtsForNvda opätovným použitím jednej inštancie mosta Google počas celého renderovania, menšími časťami špecifickými pre Google a opakovaním obnoviteľných zlyhaní mosta Chrome DevTools.
- Zmenený dialóg priebehu tak, aby sa dal minimalizovať skratkou Alt+M. Opätovné stlačenie príkazu soundWave obnoví aktívny priebeh namiesto otvorenia druhého renderovacieho dialógu.
- Vylepšené hlásenie uplynulého času a dĺžky zvuku, aby sa dlhé rendery zobrazovali v minútach alebo hodinách, nie iba v sekundách.
- Po zachytávaní všeobecných syntetizátorov NVDA sa obnovujú nastavenia hlasu, variantu, jazyka, tempa, výšky a hlasitosti, aby sa znížilo riziko prenesenia nastavení späť do bežiacej reči NVDA.
- Zatvára #5.
1.1.0
- Výrazne vylepšená podpora googleTtsForNvda. SoundWave renderuje cez most Google spoľahlivejšie, zobrazuje iba nainštalované hlasy fungujúce cez offline renderovaciu cestu, skúsi to znova, ak stránka mosta nie je pripravená, a neprepína potichu na iný hlas.
- Vylepšené ukážky googleTtsForNvda renderovaním testovacej frázy do dočasného WAV súboru pred prehratím, takže automatický náhľad môže zostať zapnutý bez použitia živej reči NVDA.
- Vylepšený text priebehu renderovania googleTtsForNvda počas čakania na zvuk od Google.
- Vylepšené renderovanie Pocket TTS preskočením prázdnych riadkov a rozdelením textu na bezpečnejšie segmenty pre model.
- Pridaná citlivosť konca vety Pocket TTS do dialógu možností syntetizátora, keď je dostupná.
- Pridané delenie špecifické pre Supertonic, aby sa dlhší vstup dal renderovať bez prekročenia limitu veľkosti vstupu modelu.
- Pridaný výstup FLAC a M4A, keď je ffmpeg nainštalovaný a dostupný v systémovej premennej PATH.
- Zmenený výber výstupného formátu tak, aby si jedno aj dávkové renderovanie pamätalo posledný vybraný formát.
- Pridané voliteľné nastavenia na použitie predvoleného výstupného formátu bez zobrazenia dialógu Uložiť ako pri jednom renderovaní alebo výberu dávkového formátu.
- Zmenené automatické prehratie dávky tak, aby dokončené renderovanie priečinka otvorilo zoznam prehrávania namiesto prehratia iba prvého súboru.
- Zmenené automatické otváranie výstupného priečinka tak, aby soundWave neotváral rovnaký priečinok opakovane v jednej relácii NVDA.
- Pridaný panel nastavení soundWave v nastaveniach NVDA pre predvolený priečinok uloženia, šablóny pomenovania a akcie po renderovaní.
- Pridané akcie po renderovaní na otvorenie výstupného priečinka, prehratie dokončeného zvukového súboru a ovládanie zobrazenia súhrnu renderovania.
- Pridané tlačidlo Otvoriť priečinok do súhrnu dokončeného renderovania.
- Pridaný vstup priečinka pre dávkové renderovanie.
- Vylepšené pomenovanie výstupu samostatnými šablónami pre priečinky jedného renderovania, jednotlivé súbory, dávkové priečinky a dávkové súbory.
- Vylepšené navrhované názvy výstupných súborov tak, aby sa vybrané názvy hlasov zahrnuli do viacerých renderovacích ciest.
- Špecializovaná podpora syntetizátorov bola rozdelená do samostatných modulov pre SAPI5, DECtalk, BestSpeech, Sonata, Pocket TTS, googleTtsForNvda, Eloquence/IBMTTS, Orpheus a všeobecné zachytávacie cesty NVDA.
- Pridané automatické zisťovanie Eloquence a IBMTTS, aby renderovali cez vyhradenú cestu enginu namiesto všeobecného zachytávania NVDA.
1.0.4
- Pridaná podpora renderovania googleTtsForNvda na základe PR #3 od Ruslana Dolovaniuka.
1.0.3
- Pridaná podpora výšky SAPI5 pomocou natívnej XML značky pitch v SAPI.
- Zmenené renderovanie WAV pre SAPI5 tak, aby používalo predvolený výstupný formát vybraného hlasu SAPI, keď je dostupný, namiesto pevného vynútenia 22,05 kHz 16-bit mono.
1.0.2
- Pridané ovládanie výšky a hlasitosti pre Orpheus, Keynote Gold a všeobecné renderovanie syntetizátorov NVDA.
- Pridaná podpora hlasitosti pre renderovanie SAPI5.
- Vylepšené klávesové nastavovanie číselných možností. Page Up a Page Down teraz robia väčšie zmeny a Home a End skočia na minimálnu alebo maximálnu hodnotu.
- Podrobnosti renderovania boli zmenené na zoznam po riadkoch, aby sa informácie o priebehu dali ľahšie kontrolovať čítačom obrazovky.
- Zapamätá sa, či sú podrobnosti renderovania zobrazené alebo skryté medzi rendermi.
- Pridané názvy vybraných hlasov do navrhovaných výstupných názvov, keď SoundWave dokáže hlas rozpoznať.
- Pridaný prístup k príručke klávesom F1 v renderovacích dialógoch soundWave a tlačidlá Pomocník dostupné klávesom Tab.
- Vylepšené klávesové skratky dialógov vrátane tlačidiel Testovať a ovládacích prvkov možností syntetizátora.
1.0.1
- Zladená podpora aktualizácií s distribúciou cez NVDA Add-on Store.
1.0.0
Riešenie problémov
- Nevytvorí sa žiadny zvuk: vybraný syntetizér nemusí sprístupňovať zvukovú cestu, ktorú soundWave dokáže renderovať. Skúste iný syntetizér a skontrolujte log NVDA.
- Eloquence alebo IBMTTS nie je dostupný: nainštalujte alebo aktualizujte príslušný doplnok NVDA, znovu načítajte NVDA a skúste to znova.
- Orpheus sa nespustí: prepnite aktuálny syntetizér NVDA na Orpheus a potom znova otvorte soundWave.
- WorldVoice sa neinicializuje: skontrolujte log NVDA, či nechýbajú súbory pod WorldVoice-workspace. soundWave nemôže renderovať WorldVoice, kým sa samotný WorldVoice nenačíta správne.
- Export MP3, FLAC alebo M4A zlyhá: nainštalujte ffmpeg a uistite sa, že príkaz ffmpeg funguje z príkazového riadka.
- Renderovanie vyzerá zaseknuté: použite Zrušiť. Ak sa problém opakuje, do hlásenia uveďte názov syntetizéra, nastavenia, typ vstupu a príslušné záznamy z logu NVDA.