Fluxo tradicional baseado em texto
Muitas ferramentas transformam primeiro a fala em texto, traduzem o texto e só depois geram fala. Cada passo separado pode acrescentar atraso e tornar a conversa menos natural.
Como funciona
O TolkTime transmite fala em direto por uma via de tradução em tempo real no servidor e devolve voz gerada com captions automáticas em 66 idiomas.



Escolha um modo, escolha os idiomas e ouça a fala traduzida para o idioma que compreende.

A experiência começa com áudio falado e termina com tradução falada. As captions automáticas são produzidas juntamente com a voz traduzida, mas não precisa de escrever, copiar texto nem alternar entre ferramentas separadas.
Muitas ferramentas transformam primeiro a fala em texto, traduzem o texto e só depois geram fala. Cada passo separado pode acrescentar atraso e tornar a conversa menos natural.
O TolkTime trata da escuta, tradução, captions e saída falada numa única sessão em direto. A experiência do utilizador mantém-se simples: fala em direto entra, fala traduzida sai.
O navegador e o servidor mantêm uma via ativa aberta para a sessão em curso, para que áudio, captions e voz traduzida possam circular continuamente.
Depois de permitir acesso ao microfone, o navegador capta áudio em direto e envia pequenos blocos de áudio por uma ligação encriptada para o TolkTime.
O servidor do TolkTime coordena o fornecedor de tradução em tempo real. As credenciais do fornecedor nunca vão para o navegador.
O texto das legends traduzidas é devolvido juntamente com o áudio e vai sendo atualizado à medida que a frase falada é processada.
O resultado traduzido é falado com a voz gerada selecionada. Dependendo do modo, ambos os lados o ouvem, um dispositivo reproduz-no, ou a voz do Listener pode ser desligada.
A mesma base de tradução em tempo real suporta Calls, conversas In-Person e o modo Listener.
Escolha da mesma lista de idiomas nos três modos. A disponibilidade não significa que todos os sotaques, dialetos ou pares de idiomas terão exatamente a mesma precisão.
As captions são criadas durante a sessão em direto para que possa ler a tradução enquanto a ouve.
A tradução é orientada para preservar significado, tom, emoção, cortesia, urgência e intensidade, soando ao mesmo tempo natural no idioma de destino.
O TolkTime transmite áudio e começa a devolver saída à medida que a fala é processada, em vez de esperar por uma gravação completa. A qualidade da ligação e a complexidade da frase continuam a afetar o atraso.
A tradução de voz em tempo real deve parecer conversacional, mas continua a ser uma tradução gerada, não uma cópia perfeita do falante original.
O TolkTime não clona a voz exata do falante. Usa uma voz gerada selecionada e procura transportar o significado, o tom e a força emocional originais para a tradução.
Pequenas pausas são normais enquanto a fala é compreendida e traduzida. As condições da rede, a prontidão do fornecedor, frases longas e o desempenho do dispositivo podem alterar o atraso.
Nomes, termos técnicos, sotaques, fala pouco clara, ruído de fundo e oradores sobrepostos podem causar erros, omissões ou captions que se atualizam à medida que chega mais contexto.
Escolha o padrão de interação que corresponde à conversa que precisa de compreender.
Crie uma Call traduzida no navegador. Os convidados entram por link.
Saiba mais sobre Calls multilinguesUse um único dispositivo para uma conversa presencial. Falem por turnos.
Explorar o modo In-PersonCompreenda a fala à sua volta com legendas em direto e voz traduzida opcional.
Explorar o modo ListenerEscolha um modo e um par de idiomas, e depois use o saldo gratuito para ouvir como a voz traduzida e as captions funcionam no seu navegador.