Tradycyjny przepływ oparty na tekście
Wiele narzędzi najpierw zamienia mowę na tekst, tłumaczy tekst, a dopiero potem generuje mowę. Każdy oddzielny krok może zwiększać opóźnienie i sprawiać, że rozmowa wydaje się mniej naturalna.
Jak to działa
TolkTime przesyła mowę na żywo przez ścieżkę tłumaczenia w czasie rzeczywistym po stronie serwera i zwraca generowany głos z automatycznymi captions w 66 językach.



Wybierz tryb, wybierz języki i słuchaj mowy tłumaczonej na język, który rozumiesz.

Doświadczenie zaczyna się od mówionego audio i kończy mówionym tłumaczeniem. Automatyczne captions są tworzone razem z tłumaczonym głosem, ale nie musisz pisać, kopiować tekstu ani przełączać się między osobnymi narzędziami.
Wiele narzędzi najpierw zamienia mowę na tekst, tłumaczy tekst, a dopiero potem generuje mowę. Każdy oddzielny krok może zwiększać opóźnienie i sprawiać, że rozmowa wydaje się mniej naturalna.
TolkTime obsługuje słuchanie, tłumaczenie, captions i mowę wyjściową w ramach jednej sesji na żywo. Doświadczenie użytkownika pozostaje proste: mowa na żywo wchodzi, tłumaczona mowa wychodzi.
Przeglądarka i serwer utrzymują jedną aktywną ścieżkę dla sesji, dzięki czemu audio, captions i tłumaczony głos mogą płynąć bez przerwy.
Po udzieleniu dostępu do mikrofonu przeglądarka przechwytuje dźwięk na żywo i wysyła małe fragmenty audio przez szyfrowane połączenie do TolkTime.
Serwer TolkTime koordynuje dostawcę tłumaczeń w czasie rzeczywistym. Dane uwierzytelniające dostawcy nigdy nie trafiają do przeglądarki.
Przetłumaczony tekst napisów wraca razem z audio i aktualizuje się w miarę przetwarzania wypowiedzi.
Przetłumaczony wynik jest wypowiadany wybranym generowanym głosem. W zależności od trybu obie strony go słyszą, odtwarza go jedno urządzenie albo można wyłączyć odczyt w Listener.
Ten sam fundament tłumaczenia w czasie rzeczywistym napędza Calls, rozmowy In-Person i tryb Listener.
Wybierasz z tej samej listy języków we wszystkich trzech trybach. Dostępność nie oznacza, że każdy akcent, dialekt i para językowa będą miały identyczną dokładność.
Captions są tworzone podczas sesji na żywo, dzięki czemu możesz czytać tłumaczenie i jednocześnie je słyszeć.
Tłumaczenie ma zachowywać znaczenie, ton, emocje, uprzejmość, pilność i intensywność, jednocześnie brzmiąc naturalnie w języku docelowym.
TolkTime przesyła audio i zaczyna zwracać wynik podczas przetwarzania mowy, zamiast czekać na całe nagranie. Jakość połączenia i złożoność wypowiedzi nadal wpływają na opóźnienie.
Tłumaczenie głosowe w czasie rzeczywistym powinno przypominać naturalną rozmowę, ale nadal jest generowanym tłumaczeniem, a nie idealną kopią oryginalnego mówcy.
TolkTime nie klonuje dokładnego głosu mówcy. Używa wybranego generowanego głosu i stara się przenieść do tłumaczenia pierwotne znaczenie, ton i siłę emocji.
Krótkie pauzy są normalne, gdy mowa jest rozumiana i tłumaczona. Warunki sieciowe, gotowość dostawcy, długie frazy i wydajność urządzenia mogą zmieniać opóźnienie.
Imiona, terminy techniczne, akcenty, niewyraźna mowa, hałas w tle i nakładający się mówcy mogą powodować błędy, pominięcia lub captions aktualizowane wraz z napływem kontekstu.
Wybierz wzorzec interakcji pasujący do rozmowy, którą chcesz zrozumieć.
Prowadź tłumaczoną rozmowę w przeglądarce. Goście dołączają przez link.
Poznaj wielojęzyczne CallsUżyj jednego urządzenia do rozmowy twarzą w twarz. Mówcie na zmianę.
Poznaj tryb In-PersonRozumiej mowę wokół siebie dzięki napisom na żywo i opcjonalnemu tłumaczonemu głosowi.
Poznaj tryb ListenerWybierz tryb i parę językową, a potem użyj darmowego salda, aby usłyszeć, jak tłumaczony głos i captions działają w twojej przeglądarce.