Luồng dựa trên văn bản truyền thống
Nhiều công cụ trước tiên biến lời nói thành văn bản, dịch văn bản, rồi mới tạo giọng nói. Mỗi bước riêng lẻ có thể làm tăng độ trễ và khiến cuộc trò chuyện bớt tự nhiên hơn.
Cách hoạt động
TolkTime truyền lời nói trực tiếp qua một đường dịch thời gian thực ở phía máy chủ và trả lại giọng nói được tạo cùng với phụ đề tự động trên 66 ngôn ngữ.



Chọn chế độ, chọn ngôn ngữ và nghe lời nói được dịch sang ngôn ngữ bạn hiểu.

Trải nghiệm bắt đầu bằng âm thanh lời nói và kết thúc bằng bản dịch được nói ra. Phụ đề tự động được tạo cùng với giọng nói đã dịch, nhưng bạn không cần gõ, sao chép văn bản hay chuyển đổi giữa các công cụ riêng biệt.
Nhiều công cụ trước tiên biến lời nói thành văn bản, dịch văn bản, rồi mới tạo giọng nói. Mỗi bước riêng lẻ có thể làm tăng độ trễ và khiến cuộc trò chuyện bớt tự nhiên hơn.
TolkTime xử lý việc nghe, dịch, phụ đề và đầu ra giọng nói trong cùng một phiên trực tiếp. Trải nghiệm của người dùng vẫn đơn giản: lời nói trực tiếp đi vào, lời nói đã dịch đi ra.
Trình duyệt và máy chủ giữ một đường dẫn trực tiếp luôn mở cho phiên đang hoạt động, để âm thanh, phụ đề và giọng nói đã dịch có thể di chuyển liên tục.
Sau khi bạn cho phép quyền microphone, trình duyệt sẽ thu âm thanh trực tiếp và gửi các khối âm thanh nhỏ qua kết nối được mã hóa tới TolkTime.
Máy chủ của TolkTime điều phối nhà cung cấp dịch thời gian thực. Credential của nhà cung cấp không bao giờ được đưa tới trình duyệt.
Văn bản phụ đề đã dịch được trả về cùng với âm thanh và cập nhật khi cụm từ đang nói được xử lý.
Kết quả dịch được đọc bằng giọng nói được tạo đã chọn. Tùy chế độ, cả hai bên đều nghe thấy, một thiết bị sẽ phát, hoặc có thể tắt voicing trong Listener.
Cùng một nền tảng dịch thời gian thực vận hành Calls, các cuộc trò chuyện In-Person và chế độ Listener.
Chọn từ cùng một danh sách ngôn ngữ trong cả ba chế độ. Việc có sẵn không có nghĩa là mọi giọng vùng miền, phương ngữ hoặc cặp ngôn ngữ đều có độ chính xác giống nhau.
Phụ đề được tạo trong phiên trực tiếp để bạn có thể vừa đọc bản dịch vừa nghe.
Bản dịch được hướng dẫn để giữ nguyên ý nghĩa, tông giọng, cảm xúc, sự lịch sự, mức độ khẩn cấp và cường độ trong khi vẫn nghe tự nhiên ở ngôn ngữ đích.
TolkTime truyền âm thanh liên tục và bắt đầu trả kết quả khi lời nói đang được xử lý thay vì chờ một bản ghi hoàn chỉnh. Chất lượng kết nối và độ phức tạp của câu nói vẫn có thể ảnh hưởng đến độ trễ.
Dịch giọng nói theo thời gian thực nên mang lại cảm giác giống một cuộc trò chuyện, nhưng đó là bản dịch được tạo ra chứ không phải bản sao hoàn hảo của người nói gốc.
TolkTime không sao chép chính xác giọng nói của người nói. Nó dùng một giọng nói được tạo đã chọn và cố gắng truyền tải ý nghĩa, tông giọng và sức nặng cảm xúc ban đầu vào bản dịch.
Những khoảng dừng ngắn là bình thường trong khi lời nói được hiểu và dịch. Điều kiện mạng, mức sẵn sàng của nhà cung cấp, câu nói dài và hiệu năng thiết bị đều có thể làm thay đổi độ trễ.
Tên riêng, thuật ngữ kỹ thuật, giọng vùng miền, lời nói không rõ, tiếng ồn nền và nhiều người nói cùng lúc có thể gây ra lỗi, thiếu sót hoặc phụ đề cập nhật lại khi có thêm ngữ cảnh.
Chọn mô hình tương tác phù hợp với cuộc trò chuyện bạn cần hiểu.
Tạo một Call trên trình duyệt có dịch. Khách tham gia bằng liên kết.
Tìm hiểu về Calls đa ngôn ngữDùng một thiết bị cho cuộc trò chuyện trực tiếp. Thay phiên nhau nói.
Khám phá chế độ In-PersonHiểu lời nói xung quanh bạn bằng phụ đề trực tiếp và giọng nói dịch tùy chọn.
Khám phá chế độ ListenerChọn chế độ và cặp ngôn ngữ, rồi dùng số dư miễn phí để nghe cách giọng nói và phụ đề đã dịch hoạt động trong trình duyệt của bạn.