So funktioniert es

Von gesprochener Sprache zu übersetzter Stimme

TolkTime leitet gesprochene Sprache über einen serverseitigen Echtzeitpfad und gibt eine generierte Stimme zusammen mit automatischen Untertiteln in 66 Sprachen zurück.

Live call screen with controls, participants, captions, multiplier, and balance
In-Person mode live translation screen with turn controls, captions, and translated voice
Listener mode with live translated subtitles and optional translated voice

So funktioniert TolkTime in vier Schritten

Wählen Sie einen Modus, wählen Sie Sprachen und hören Sie gesprochene Sprache in die Sprache übersetzt, die Sie verstehen.

TolkTime call setup screen showing mode and language controls

Was bedeutet Stimme zu Stimme

Alles beginnt mit Live-Audio und endet mit einer gesprochenen Übersetzung. Automatische Untertitel entstehen parallel zur übersetzten Stimme, aber Sie müssen nichts tippen, keinen Text kopieren und nicht zwischen verschiedenen Werkzeugen wechseln.

Der traditionelle Textweg

Viele Werkzeuge wandeln Sprache zunächst in Text um, übersetzen diesen Text und erzeugen erst danach eine Stimme. Jeder einzelne Schritt kann Verzögerung hinzufügen und das Gespräch weniger natürlich wirken lassen.

SpracheTextÜbersetzter TextGenerierte Stimme

TolkTime: von Stimme zu Stimme

TolkTime bündelt Zuhören, Übersetzen, Untertitel und Sprachausgabe in einer einzigen Live-Sitzung. Das Nutzungserlebnis bleibt einfach: Gesprochene Sprache geht hinein, übersetzte Sprache kommt heraus.

Live-SpracheÜbersetzte Stimme

Was passiert, wenn Sie sprechen

Browser und Server halten für die aktive Sitzung einen durchgehenden Live-Kanal offen, damit Audio, Untertitel und übersetzte Stimme ohne Unterbrechung fließen können.

Der Browser erfasst Sprache

Nachdem Sie Zugriff auf das Mikrofon gewährt haben, erfasst der Browser Live-Audio und sendet kleine Audioblöcke über eine verschlüsselte Verbindung an TolkTime.

Die Übersetzung bleibt auf dem Server

Der TolkTime-Server koordiniert den Echtzeit-Übersetzungsanbieter. Zugangsdaten des Anbieters werden nie an den Browser gesendet.

Untertitel erscheinen automatisch

Der Text der übersetzten Untertitel wird zusammen mit dem Audio zurückgegeben und aktualisiert sich, während die gesprochene Phrase verarbeitet wird.

Die übersetzte Stimme wird abgespielt

Das Übersetzungsergebnis wird mit der ausgewählten generierten Stimme gesprochen. Je nach Modus können es beide Seiten hören, ein einzelnes Gerät oder die Wiedergabe kann im Modus Zuhörer deaktiviert sein.

Gebaut für Verstehen in Echtzeit

Die gleiche Echtzeit-Übersetzungsbasis arbeitet in Anrufen, persönlichen Gesprächen und im Modus Zuhörer.

66 unterstützte Sprachen

Verwenden Sie dieselbe Sprachliste in allen drei Modi. Die Verfügbarkeit einer Sprache bedeutet nicht, dass alle Akzente, Dialekte oder Sprachpaare dieselbe Genauigkeit haben.

Automatische übersetzte Untertitel

Untertitel werden während der Live-Sitzung erzeugt, damit Sie die Übersetzung nicht nur hören, sondern auch lesen können.

Ton und Emotionen sind wichtig

Die Übersetzung wird darauf ausgerichtet, Bedeutung, Ton, Emotion, Höflichkeit, Dringlichkeit und Intensität zu bewahren und gleichzeitig natürlich in der Zielsprache zu klingen.

Für geringe Latenz gebaut

TolkTime streamt Audio und beginnt schon während der Verarbeitung der Sprache mit der Ausgabe, anstatt auf eine vollständige Aufnahme zu warten. Die Latenz hängt aber weiterhin von Verbindungsqualität und Satzkomplexität ab.

Was Sie erwarten können

Echtzeit-Stimmübersetzung sollte sich wie ein Gespräch anfühlen, ist aber dennoch eine generierte Übersetzung und keine perfekte Kopie der ursprünglichen Stimme.

Generierte übersetzte Stimme

TolkTime klont die Stimme des Sprechers nicht exakt. Stattdessen wird eine ausgewählte generierte Stimme verwendet, die versucht, ursprüngliche Bedeutung, Ton und emotionale Kraft in die Übersetzung zu übertragen.

Niedrige Latenz ist nicht null Latenz

Kurze Pausen sind normal, während Sprache erkannt und übersetzt wird. Die Latenz kann von Netzwerkbedingungen, Bereitschaft des Anbieters, langen Sätzen und der Geräteleistung beeinflusst werden.

Übersetzung kann unvollkommen sein

Namen, technische Begriffe, Akzente, undeutliche Sprache, Hintergrundgeräusche und mehrere gleichzeitig sprechende Personen können zu Fehlern, Auslassungen oder Untertiteln führen, die sich mit mehr Kontext weiter präzisieren.

Ein Übersetzungssystem, drei Situationen

Wählen Sie die Art der Interaktion, die zu dem Gespräch passt, das Sie verstehen möchten.

Persönlich

Nutzen Sie ein gemeinsames Gerät für ein Gespräch von Angesicht zu Angesicht. Sprechen Sie abwechselnd.

Modus Persönlich entdecken

Zuhörer

Verstehen Sie Sprache in Ihrer Umgebung mit Live-Untertiteln und auf Wunsch übersetzter Stimme.

Modus Zuhörer entdecken

Probieren Sie Live-Stimmübersetzung selbst aus

Wählen Sie einen Modus und ein Sprachpaar und nutzen Sie dann das kostenlose Guthaben, um zu hören, wie übersetzte Stimme und Untertitel in Ihrem Browser funktionieren.