Subformer
Nemokama · Be registracijos · Veikia jūsų naršyklėje

Nemokama Tamil balso į tekstą

தமிழ்

Įmeskite Tamil garso arba vaizdo failą ir gaukite pilną transkriptą su laiko žymomis - viskas jūsų naršyklėje, be prisiregistravimo. Modelis atsisiunčiamas tik vieną kartą (~75 MB) ir saugomas lokaliai, todėl vėlesni paleidimai yra akimirksniu ir veikia neprisijungus.

Tikrinama, ar naršyklė palaiko…

Reikia didesnio tikslumo ar daugiau kalbų?

Debesų pagrindu veikianti Tamil kalbos į tekstą konvertavimo paslauga

Nemokamas naršyklės įrankis naudoja nedidelį atvirojo kodo modelį – tinka švariam garsui, tačiau gali sunkiai susidoroti su stipriais Tamil akcentais, triukšmu ar persidengiančiais kalbėtojais ir apima tik ribotą kalbų rinkinį. Norėdami gauti transliacijos lygio tikslumą, daug platesnį kalbų palaikymą ir SRT/VTT/TXT atsisiuntimus, naudokite mūsų mokamą debesų pagrindu veikiančią kalbos į tekstą konvertavimo paslaugą.

Išbandykite debesų pagrindu veikiančią kalbos į tekstą konvertavimo paslaugą

Kaip tai veikia

  1. 1. Nuvilkite failą

    Įkelkite bet kokį Tamil garso arba vaizdo failą - palaikomi MP3, WAV, M4A, MP4 ir WEBM.

  2. 2. Transkribuoti

    Pirmas spustelėjimas atsisiunčia ~75 MB modelį į jūsų naršyklę. Vėliau atpažinimas vyksta akimirksniu ir veikia neprisijungus.

  3. 3. Atsisiųsti

    Išsaugokite transkriptą kaip TXT, SRT arba VTT. Jūsų garso įrašas ir rezultatas niekada nepalieka jūsų įrenginio.

Jūsų garso įrašas lieka jūsų įrenginyje.

Atpažinimas vyksta visiškai jūsų naršyklėje naudojant WebAssembly. Vieninteliai tinklo užklausimai reikalingi modeliui ir WebAssembly vykdymui parsisiųsti - abu yra vieši, statiniai ištekliai. Mes nematome jūsų garso įrašo ir nematome transkripto.

Kaip Tamil transkripcija veikia jūsų naršyklėje

Kalbos atpažinimas paprastai reiškia garso įkėlimą į kažkieno GPU. Čia modelis veikia jūsų pačių kompiuteryje, todėl tai yra nemokama ir privati tuo pačiu metu.

Open-source recognition model
Atvirojo kodo neuroninis modelis, apmokytas daugiakalbiu garsu – todėl vienas atsisiuntimas apdoroja Tamil be jokio kalbai specifinio modelio, kurį reikėtų atsisiųsti.
WebAssembly
Išvadų vykdymo laikas yra sukompiliuotas į „WebAssembly“, todėl skaitmeninis kodas veikia beveik natūraliu greičiu smėlio dėžės skirtuke be jokio papildinio ir diegimo.
On-device inference
~75 MB kvantuotas modelis įkeliamas, o dekodavimo ciklas vykdomas visiškai kliento pusėje. Nė viena konvejerio dalis nesikreipia į serverį, kai puslapis yra įkeltas.
Web Audio API
Jūsų failas dekoduojamas ir peratrankomas į 16 kHz mono, kurio tikisi modelis, naudojant naršyklės garso apdorojimo grandinę, todėl priimamas bet koks formatas, kurį jūsų naršyklė gali atkurti.
Premium - taip pat iš Subformer

Dažnai užduodami klausimai

Išbandykite kitas nemokamas kalbas balso atpažinimui