Onkraj TTS: STT, glasba, zvočni učinki in sinhronizacija

Vsi paketi (razpoložljivost funkcij se razlikuje glede na raven)2 min branja
🎤
Scribe v2 (STT)Več kot 90 jezikov, časovni žigi na ravni besed, ločevanje govorcev (32 govorcev), zaznavanje entitet. Paketni in realnočasovni način WebSocket.
🎵
Ustvarjanje glasbeIz besedila v glasbo z nadzorom zvrsti, sloga in zgradbe. Vokal v več jezikih. Urejanje po odsekih. Do 5 minut.
🔊
Zvočni učinkiIz besedila v zvočne učinke. Kar potrebujete, opišete v naravnem jeziku. Izhod MP3 ali WAV brez licenčnin.
🌍
SinhronizacijaSamodejna sinhronizacija videa/zvoka v 29 jezikov. Ohrani glas izvirnega govorca. Podpira MP4, WAV, MOV, MP3.
🔇
Izolator glasuOdstranite hrup ozadja in odmev. Sprejme datoteke do 500 MB/1 ure. Vhodi WAV, MP3, FLAC, OGG, AAC.
🔄
Spreminjanje glasuPreoblikovanje glasu iz govora v govor. Na obstoječi zvok uporabite poljuben glas ob ohranitvi vsebine in časovnega poteka.
Onkraj TTS: STT, glasba, zvočni učinki in sinhronizacija | ElevenLabs API | NativeAI Hub