EZ
EZ2Conv

Fala para Texto

Transforme fala em texto de duas maneiras: dite ao vivo com a Web Speech API do seu navegador, ou envie um arquivo de áudio ou vídeo e transcreva-o com um modelo de IA Whisper que roda no seu navegador. Suporta mais de 99 idiomas, edição, cópia e download — grátis e sem login.

Characters
0
Words
0
Sentences
0
Duration
00:00

Transcript

You can edit the text below

Como Usar

  1. [Tempo real] Selecione a aba "Tempo real", escolha seu idioma e clique em "Iniciar gravação"
  2. [Tempo real] Fale claramente no microfone - o texto aparece em tempo real conforme você fala
  3. [Upload] Selecione a aba "Upload", escolha um modelo de IA e envie um arquivo de áudio/vídeo
  4. [Upload] Clique em "Transcrever" - o modelo de IA é baixado automaticamente no primeiro uso
  5. Edite, copie ou baixe sua transcrição quando terminar usando as opções disponíveis

Dicas Úteis

  • O modo tempo real requer o navegador Chrome, Edge ou Safari
  • O envio de arquivos funciona offline após o download do modelo de IA
  • Para arquivos longos, o modelo 'Tiny' oferece o processamento mais rápido
  • Apenas o upload de arquivo mantém o áudio no seu dispositivo: o modo em tempo real o envia ao serviço de voz do navegador, a menos que haja reconhecimento local disponível

Duas maneiras de transformar fala em texto

O que esta ferramenta faz

O Speech to Text combina dois motores independentes com o mesmo objetivo. O modo em tempo real usa a Web Speech API — a interface SpeechRecognition presente nos navegadores atuais — e vai escrevendo as palavras na página enquanto você fala: primeiro como texto provisório e, quando você faz uma pausa, como linha definitiva. Já o modo de envio de arquivo carrega um modelo de IA Whisper por meio do Transformers.js e transcreve uma gravação que você já tem, sem ouvir nenhum microfone.

Quando usar cada modo

O ditado em tempo real é ótimo para registrar ideias com as mãos livres: anotações de reunião, um rascunho rápido ou um lembrete que você prefere falar a digitar. Ele se destaca em sessões curtas e ao vivo, onde ver o texto surgir na hora mantém o ritmo.

O envio de arquivo combina melhor com material já gravado: uma entrevista, uma aula, um recado de voz ou a trilha de áudio de um vídeo. Depois que o modelo Whisper conclui o download inicial, esse modo continua funcionando mesmo sem conexão, o que ajuda em gravações longas e tarefas repetidas.

Um passo a passo rápido

Para trabalhar ao vivo, escolha o idioma na lista, clique em Start Recording e conceda o acesso ao microfone quando o navegador pedir; sua voz preenche a transcrição, que você pode editar depois. Para uma gravação, mude para File Upload, selecione um modelo — Tiny para velocidade, Small para mais precisão multilíngue — e solte um arquivo MP3, WAV, MP4 ou semelhante. Terminado o processamento, o texto fica pronto para copiar ou baixar.

Compatibilidade e pontos de atenção

O reconhecimento em tempo real depende do navegador: Chrome, Edge e Safari implementam a Web Speech API, ao contrário do Firefox, onde vale usar o File Upload. As versões recentes do Chrome podem instalar um modelo de idioma no dispositivo e manter o áudio do microfone local; caso contrário, a fala é processada pelo serviço de voz do fabricante do navegador. A lista em tempo real oferece 22 idiomas, enquanto o Whisper cobre mais de 99 com detecção automática. O envio aceita formatos comuns de áudio e vídeo até 500MB; para vídeo, extrair o áudio antes acelera o processo e melhora o resultado.

Perguntas frequentes

Os dois motores ficam disponíveis sem limites: o ditado ao vivo pela Web Speech API e a transcrição de arquivos com os modelos Whisper Tiny, Base e Small, para áudio ou vídeo de qualquer duração. Não há cobrança por minuto nem modelos premium bloqueados atrás de pagamento.
Depende do modo. A transcrição por arquivo executa um modelo Whisper com o Transformers.js localmente, então a gravação e o texto não saem do dispositivo. O modo em tempo real usa a Web Speech API do navegador, que costuma enviar o áudio do microfone aos servidores do fabricante para reconhecê-lo, a menos que o Chrome tenha instalado o modelo no dispositivo. O EZ2Conv nunca recebe o seu áudio.
Nenhuma conta é necessária. Escolha o modo, dite ou envie sua gravação e depois edite, copie ou baixe o texto. Não pedimos e-mail nem dados pessoais.
Chrome, Edge e Safari implementam a Web Speech API exigida pelo modo ao vivo; o Firefox não a inclui. Em qualquer navegador, o modo File Upload funciona, pois transcreve com o Whisper sem depender dessa API.
O modo em tempo real precisa do microfone para captar sua voz, e o navegador pergunta uma vez. Se você recusar, esse modo não escuta, mas o envio de arquivo não exige microfone, pois lê uma gravação existente.
A lista em tempo real traz 22 idiomas via Web Speech API, e o modo por arquivo com Whisper reconhece mais de 99 com detecção automática. Selecione o idioma antes de gravar para melhorar a precisão.