पारंपरिक टेक्स्ट-आधारित प्रवाह
कई टूल पहले बोलचाल को टेक्स्ट में बदलते हैं, फिर टेक्स्ट का अनुवाद करते हैं और फिर आवाज़ बनाते हैं। हर अलग चरण delay बढ़ा सकता है और बातचीत को कम स्वाभाविक बना सकता है।
यह कैसे काम करता है
TolkTime लाइव बोलचाल को सर्वर-साइड रियल-टाइम ट्रांसलेशन पाथ से भेजता है और 66 भाषाओं में ऑटोमेटेड सबटाइटल्स के साथ अनुवादित आवाज़ वापस देता है।



एक मोड चुनें, भाषाएँ चुनें और उस भाषा में अनुवादित बोल सुनें जिसे आप समझते हैं।

यह अनुभव बोले गए ऑडियो से शुरू होता है और बोले गए अनुवाद पर खत्म होता है। ऑटोमेटेड सबटाइटल्स अनुवादित आवाज़ के साथ-साथ बनते हैं, लेकिन आपको टाइप, कॉपी-पेस्ट या अलग-अलग टूल्स के बीच बदलना नहीं पड़ता।
कई टूल पहले बोलचाल को टेक्स्ट में बदलते हैं, फिर टेक्स्ट का अनुवाद करते हैं और फिर आवाज़ बनाते हैं। हर अलग चरण delay बढ़ा सकता है और बातचीत को कम स्वाभाविक बना सकता है।
TolkTime सुनना, अनुवाद, सबटाइटल्स और voice output को एक ही लाइव सत्र में संभालता है। उपयोगकर्ता अनुभव सरल रहता है: लाइव बोलचाल अंदर, अनुवादित बोलचाल बाहर।
ब्राउज़र और सर्वर सक्रिय सत्र के लिए एक लाइव पाथ खुला रखते हैं ताकि ऑडियो, सबटाइटल्स और अनुवादित आवाज़ लगातार बहती रहे।
माइक्रोफ़ोन अनुमति देने के बाद ब्राउज़र लाइव ऑडियो कैप्चर करता है और छोटे-छोटे ऑडियो हिस्से एन्क्रिप्टेड कनेक्शन के माध्यम से TolkTime को भेजता है।
TolkTime का सर्वर रियल-टाइम ट्रांसलेशन प्रदाता को मैनेज करता है। प्रदाता की credentials कभी ब्राउज़र तक नहीं जातीं।
अनुवादित सबटाइटल टेक्स्ट ऑडियो के साथ वापस आता है और बोले गए वाक्य के आगे बढ़ने के साथ अपडेट होता रहता है।
अनुवाद का परिणाम चुनी हुई बनाई गई आवाज़ में सुनाया जाता है। मोड के अनुसार दोनों पक्ष सुनते हैं, एक डिवाइस चलाता है, या लिस्नर मोड में आवाज़ बंद की जा सकती है।
एक ही रियल-टाइम ट्रांसलेशन आधार कॉल, इन-पर्सन बातचीत और लिस्नर मोड को शक्ति देता है।
तीनों मोड में एक ही भाषा सूची से चुनें। उपलब्धता का मतलब यह नहीं है कि हर उच्चारण, बोली या language pair पर समान सटीकता मिलेगी।
सबटाइटल्स लाइव सत्र के दौरान बनते हैं ताकि आप अनुवाद को पढ़ भी सकें और सुन भी सकें।
अनुवाद को इस तरह निर्देशित किया जाता है कि अर्थ, टोन, भावना, विनम्रता, तात्कालिकता और तीव्रता बनी रहे ताकि वह लक्ष्य भाषा में स्वाभाविक लगे।
TolkTime ऑडियो स्ट्रीम करता है और पूरे रिकॉर्डिंग के खत्म होने का इंतज़ार करने के बजाय बोलचाल के प्रोसेस होते ही परिणाम देना शुरू कर देता है। कनेक्शन की गुणवत्ता और वाक्य की जटिलता फिर भी delay को प्रभावित कर सकती है।
रियल-टाइम वॉइस ट्रांसलेशन को बातचीत जैसा महसूस होना चाहिए, लेकिन यह अब भी मूल वक्ता की पूरी नकल नहीं बल्कि generated translation है।
TolkTime वक्ता की सटीक आवाज़ की नकल नहीं करता। यह चुनी हुई बनाई गई आवाज़ का उपयोग करता है और मूल अर्थ, टोन और भावनात्मक असर को अनुवाद में पहुँचाने की कोशिश करता है।
जब बोलचाल समझी और अनुवादित की जा रही होती है, तब छोटे विराम सामान्य होते हैं। नेटवर्क स्थिति, provider readiness, लंबे वाक्य और डिवाइस प्रदर्शन delay को बदल सकते हैं।
नाम, तकनीकी शब्द, उच्चारण, अस्पष्ट बोलचाल, बैकग्राउंड शोर और एक साथ बोलने वाले लोग गलतियाँ, छूटे हुए हिस्से या अधिक संदर्भ मिलने पर अपडेट होने वाले सबटाइटल्स का कारण बन सकते हैं।
उस बातचीत के लिए सही इंटरैक्शन पैटर्न चुनें जिसे आपको समझना है।
ब्राउज़र में अनुवादित कॉल होस्ट करें। मेहमान लिंक से जुड़ते हैं।
बहुभाषी कॉल के बारे में और जानेंआमने-सामने की बातचीत के लिए एक ही डिवाइस का उपयोग करें। बारी-बारी से बोलें।
इन-पर्सन मोड देखेंलाइव सबटाइटल्स और वैकल्पिक अनुवादित आवाज़ के साथ अपने आसपास की बात समझें।
लिस्नर मोड देखेंएक मोड और language pair चुनें, फिर अपने ब्राउज़र में मुफ़्त बैलेंस के साथ सुनें कि अनुवादित आवाज़ और सबटाइटल्स कैसे काम करते हैं।