tools / tts
tts/
Texto para fala com a síntese de voz do seu navegador. Textos longos são enfileirados frase por frase, com a frase atual destacada.
Texto
Progresso
A API de síntese de voz do navegador não fornece os dados de áudio, portanto não é possível exportar arquivos de áudio. Para guardar o áudio, grave-o com o gravador do sistema. As vozes disponíveis dependem do sistema operacional e do navegador. As vozes marcadas com "(online)" são sintetizadas na nuvem pelo fabricante do navegador, então o texto é enviado aos servidores dele; escolha uma voz local para conteúdo sensível.
Perguntas frequentes
Posso exportar a fala como MP3 ou outro arquivo de áudio?
Não. A ferramenta usa a interface de síntese de voz do próprio navegador, que apenas reproduz o som e não entrega nenhum dado de áudio, então não há o que exportar. Se você precisa de um arquivo de áudio, a única opção é gravar a reprodução com o recurso de gravação de áudio ou de tela do sistema.
E se a lista de vozes não tem voz em português ou a que eu quero?
As vozes da lista vêm inteiramente do seu sistema operacional e do navegador, e a ferramenta não pode adicionar nenhuma. Se o sistema não tem voz em português, a página mostra "Nenhuma voz em português encontrada neste sistema". Baixe uma nas configurações de fala ou de acessibilidade do sistema e reabra a página. A lista não separa vozes masculinas e femininas, então experimente uma a uma, se isso for importante.
E se o menu de vozes fica em "Carregando…" ou diz que a síntese de voz não é suportada?
No primeiro caso, em geral o navegador ainda não devolveu a lista de vozes. A ferramenta espera até cerca de 5 segundos e depois recorre à voz padrão do sistema, com um aviso, e a reprodução normalmente continua funcionando. O segundo caso significa que este navegador não tem síntese de voz; mude para a versão mais recente do Chrome, Edge ou Safari.
O que significa "(online)" ao lado de uma voz? Meu texto é enviado?
As vozes marcadas com "(online)" são sintetizadas na nuvem pelo fabricante do navegador, então o texto lido é enviado aos servidores dele; as vozes sem a marca são locais e o texto permanece no seu dispositivo. A própria ferramenta não envia nem salva o que você digita. Para textos privados, escolha uma voz sem a marca "(online)".
Por que uma mudança na velocidade ou no tom não surte efeito na hora?
Uma mudança no controle deslizante feita durante a reprodução vale a partir da próxima frase: cada frase é entregue ao navegador separadamente, e suas configurações ficam fixas quando ela começa. Para ouvir na hora, clique em "Reproduzir do início" ou clique numa frase no painel "Progresso" para recomeçar dali. A velocidade vai de 0,5 a 2 vezes, o tom de 0 a 2 e o volume de 0 a 100%. Editar o texto durante a reprodução interrompe a leitura.
Como o texto longo é dividido em frases? Por que as pausas soam pouco naturais?
A ferramenta divide o texto na pontuação final de frase e nas quebras de linha (。!?;… e também . ! ? ; sendo que o ponto só conta quando vem seguido de espaço ou do fim do texto) e entrega as frases ao navegador uma por vez. Uma frase com mais de 160 caracteres é dividida de novo em vírgulas, dois-pontos ou espaços; uma frase longa sem um bom ponto de quebra é cortada num tamanho fixo, o que soa pouco natural, então adicionar pontuação ao texto ajuda muito. Isso é feito porque alguns navegadores cortam uma única fala depois de cerca de 15 segundos.
Como começar do meio do texto e como continuar depois de pausar?
Clique em qualquer frase no painel "Progresso" à direita e a leitura começa dessa frase. Durante a reprodução, "Pausar" pausa e o botão vira "Continuar"; "Parar" volta ao estado inicial, e "Reproduzir" começa então do início. Se uma frase não puder ser lida, a página mostra o erro e pula para a próxima frase.