Flujo tradicional basado en texto
Muchas herramientas convierten primero el habla en texto, traducen el texto y luego generan voz. Cada paso separado puede añadir retraso y hacer que la conversación resulte menos natural.
Cómo funciona
TolkTime transmite la voz en directo por una ruta de traducción en tiempo real del lado del servidor y devuelve voz generada con subtítulos automáticos en 66 idiomas.



Elige un modo, elige idiomas y escucha el habla traducida al idioma que entiendes.

La experiencia comienza con audio hablado y termina con traducción hablada. Los subtítulos automáticos se generan junto con la voz traducida, pero no tienes que escribir, copiar texto ni pasar de una herramienta a otra.
Muchas herramientas convierten primero el habla en texto, traducen el texto y luego generan voz. Cada paso separado puede añadir retraso y hacer que la conversación resulte menos natural.
TolkTime integra escucha, traducción, subtítulos y salida hablada en una sola sesión en directo. La experiencia sigue siendo simple: entra voz en directo y sale voz traducida.
El navegador y el servidor mantienen un canal continuo en directo para la sesión activa, de modo que audio, subtítulos y voz traducida fluyen sin interrupciones.
Después de permitir el acceso al micrófono, el navegador captura audio en directo y envía pequeños bloques de audio a TolkTime por una conexión cifrada.
El servidor de TolkTime coordina al proveedor de traducción en tiempo real. Las credenciales del proveedor nunca se envían al navegador.
El texto de los subtítulos traducidos vuelve junto con el audio y se actualiza mientras se procesa la frase hablada.
El resultado de la traducción se reproduce con la voz generada seleccionada. Según el modo, puede oírlo ambas partes, una sola persona en un dispositivo o permanecer desactivado en el modo Oyente.
La misma base de traducción en tiempo real funciona en Llamadas, conversaciones En persona y el modo Oyente.
Usa la misma lista de idiomas en los tres modos. Que un idioma esté disponible no significa que todos los acentos, dialectos o pares lingüísticos tengan la misma precisión.
Los subtítulos se generan durante la sesión en directo para que no solo escuches la traducción, sino que también la leas.
La traducción intenta conservar el significado, el tono, la emoción, la cortesía, la urgencia y la intensidad, manteniendo un sonido natural en el idioma de destino.
TolkTime transmite el audio y empieza a devolver salida mientras procesa el habla, en lugar de esperar una grabación completa. Aun así, la latencia sigue dependiendo de la calidad de la conexión y de la complejidad de las frases.
La traducción de voz en tiempo real debe sentirse como una conversación, pero sigue siendo traducción generada y no una copia perfecta de la voz original.
TolkTime no clona exactamente la voz de la persona que habla. En su lugar, utiliza una voz generada seleccionada que intenta trasladar a la traducción el significado, el tono y la fuerza emocional originales.
Las pausas breves son normales mientras se comprende y traduce el habla. Las condiciones de red, la disponibilidad del proveedor, las frases largas y el rendimiento del dispositivo pueden cambiar el retraso.
Los nombres, términos técnicos, acentos, habla poco clara, ruido de fondo y varias personas hablando a la vez pueden causar errores, omisiones o subtítulos que se actualizan cuando llega más contexto.
Elige el patrón de interacción que mejor encaje con la conversación que necesitas entender.
Organiza una llamada traducida en el navegador. Los invitados se unen por enlace.
Conoce las llamadas multilingüesUsa un dispositivo para una conversación cara a cara. Hablad por turnos.
Explora el modo En personaEntiende el habla a tu alrededor con subtítulos en directo y voz traducida opcional.
Explora el modo OyenteElige un modo y un par de idiomas, y luego usa el saldo gratuito para escuchar cómo funcionan la voz traducida y los subtítulos en tu navegador.