Subformer
Grátis · Sem cadastro · Executa no seu navegador

Grátis Spanish Fala para Texto

Español

Solte um Spanish arquivo de áudio ou vídeo e obtenha uma transcrição completa com marcações de tempo - tudo no seu navegador, sem cadastro. O modelo é baixado uma vez (~75 MB) e fica em cache localmente, então as execuções subsequentes são instantâneas e funcionam offline.

Verificando suporte do navegador…

Precisa de maior precisão ou mais idiomas?

Speech to Text Spanish baseado em nuvem

A ferramenta gratuita no navegador executa um pequeno modelo de código aberto - bom para áudio limpo, mas pode ter dificuldades com sotaques Spanish fortes, ruído ou falantes sobrepostos, e cobre apenas um conjunto limitado de idiomas. Para precisão de nível profissional, suporte a idiomas muito mais amplo e downloads SRT/VTT/TXT, use nosso Speech to Text pago baseado em nuvem.

Experimentar Speech to Text baseado em nuvem

Como funciona

  1. 1. Solte um arquivo

    Solte qualquer Spanish arquivo de áudio ou vídeo - MP3, WAV, M4A, MP4 e WEBM são todos suportados.

  2. 2. Transcrever

    O primeiro clique baixa o modelo de ~75 MB para o seu navegador. Depois disso, o reconhecimento é instantâneo e funciona offline.

  3. 3. Baixar

    Salve a transcrição como TXT, SRT ou VTT. Seu áudio e o resultado nunca saem do seu dispositivo.

Seu áudio permanece no seu dispositivo

O reconhecimento é executado inteiramente no seu navegador usando WebAssembly. As únicas requisições de rede são para buscar o modelo e o runtime do WebAssembly - ambos são ativos públicos e estáticos. Nós não vemos seu áudio nem a transcrição.

Como a transcrição Spanish roda no seu navegador

O reconhecimento de fala normalmente significa enviar seu áudio para a GPU de alguém. Aqui, o modelo roda na sua própria máquina, o que torna isso gratuito e privado ao mesmo tempo.

Open-source recognition model
Um modelo neural de código aberto treinado em áudio multilíngue - é por isso que um único download lida com Spanish sem a necessidade de buscar um modelo específico para o idioma.
WebAssembly
O tempo de execução de inferência é compilado para WebAssembly, então o código numérico é executado em velocidade quase nativa dentro de uma aba em sandbox, sem plugin e sem instalação.
On-device inference
O modelo quantizado de ~75 MB é carregado e o loop de decodificação é totalmente impulsionado no lado do cliente. Nada no pipeline faz chamadas a um servidor depois que a página é carregada.
Web Audio API
Seu arquivo é decodificado e reamostrado para o mono de 16 kHz que o modelo espera usando o pipeline de áudio do próprio navegador, então qualquer formato que seu navegador possa reproduzir é aceito.
Premium - também do Subformer

Perguntas frequentes

Experimente outros idiomas gratuitos de fala para texto