Įmeskite bet kokį garso arba vaizdo failą, pasirinkite kalbą ir gaukite pilną transkriptą su laiko žymomis - viskas jūsų naršyklėje. Modelis atsisiunčiamas tik vieną kartą (~75 MB) ir saugomas lokaliai, todėl vėlesni paleidimai yra akimirksniu ir veikia neprisijungus.
Atpažinimas vyksta lokaliai. Jūsų garso įrašas niekada nepalieka jūsų įrenginio.
Modelis talpinamas jūsų naršyklėje. Pakartotiniai paleidimai veikia neprisijungus.
Nereikia paskyros, kreditų ar naudojimo apribojimų. Galite naudoti iš karto.
Kalbos atpažinimas paprastai reiškia garso įkėlimą į kažkieno GPU. Čia modelis veikia jūsų pačių kompiuteryje, todėl įrankis yra nemokamas ir privatus tuo pačiu metu.
Kompromisas yra modelio dydis. Įrenginyje esantys svoriai yra tik dalis to, ką naudoja talpinama paslauga, todėl tikslumas sumažėja esant triukšmingam garsui, stipriems akcentams ir persidengiantiems kalbėtojams – būtent čia pasiteisina žemiau esanti debesies parinktis.
Nemokamas naršyklės įrankis naudoja nedidelį atvirojo kodo modelį – tinka švariam garsui, tačiau gali sunkiai susidoroti su stipriais akcentais, triukšmu ar persidengiančiais kalbėtojais ir apima tik ribotą kalbų rinkinį. Norėdami gauti transliacijos lygio tikslumą, daug platesnį kalbų palaikymą ir SRT/VTT/TXT atsisiuntimus, naudokite mūsų mokamą debesų pagrindu veikiančią kalbos į tekstą konvertavimo paslaugą.
Išbandykite debesų pagrindu veikiančią kalbos į tekstą konvertavimo paslaugą