उपयोग गाइड
dicto आप जो कहते या टाइप करते हैं उसे बड़े, साफ़ टेक्स्ट के रूप में दिखाता है। यह गाइड बताती है कि ऐप कैसे काम करता है।
विषय-सूची
शुरू करना
dicto पहली बार शुरू करने पर उपयोगकर्ताओं को एक छोटी शुरुआती प्रक्रिया से गुज़ारा जाता है, जिसमें डिफ़ॉल्ट बोली जाने वाली भाषा और रंग योजना चुनी जाती है। दोनों को कभी भी सेटिंग्स में बदला जा सकता है। इन वरीयता स्क्रीनों के बाद ऐप की सुविधाओं के बारे में बुनियादी निर्देशों की तीन स्क्रीनें आती हैं, जिन्हें छोड़ा जा सकता है।
माइक्रोफ़ोन बटन पहली बार दबाने पर iOS ऐक्सेस अनुमतियाँ स्क्रीनें दिखाकर आपके डिवाइस पर वाक् पहचान और माइक्रोफ़ोन तक पहुँच की अनुमति माँगेगा। ये दोनों Apple की सेवाएँ हैं और आपकी बात को टेक्स्ट के रूप में दिखाने के लिए dicto को इनकी ज़रूरत होती है। “अनुमति दें” पर टैप करें, या बाद में पहुँच चालू करने के लिए iOS का सेटिंग्स ऐप खोलें, सेटिंग्स ▸ dicto पर जाएँ, और माइक्रोफ़ोन तथा वाक् पहचान चालू करें।
मुख्य स्क्रीन
मुख्य स्क्रीन मौजूदा संदेश और संदेश बनाने, साफ़ करने तथा दोबारा देखने के नियंत्रण दिखाती है। पोर्ट्रेट ओरिएंटेशन थोड़ा बड़ा टेक्स्ट दिखाता है (छोटे संदेशों के लिए अच्छा), और लैंडस्केप ओरिएंटेशन लंबा टेक्स्ट दिखाता है (थोड़े लंबे या संदर्भ वाले संदेशों के लिए अच्छा)।
- संदेश प्रदर्शन क्षेत्र: स्क्रीन पर निर्देश और मौजूदा संदेश दिखाता है, उपलब्ध जगह जितना बड़ा कर सकती है उतना बड़ा, और बोलते समय रीयल-टाइम में अपडेट होता रहता है। डिक्टेशन शुरू या बंद करने के लिए इस क्षेत्र पर डबल-टैप करें। मौजूदा संदेश संपादित करने के लिए देर तक दबाएँ। लंबे संदेश अपने आप स्क्रॉल होते हैं; सेटिंग्स में हाथ से स्क्रॉल करने पर स्विच करें।
- माइक्रोफ़ोन बटन: बोला गया संदेश शुरू या बंद करता है। देखें बोलना और डिक्टेशन। Solo में आवाज़ दर्ज करना शुरू करने के लिए दबाए रखें।
- कीबोर्ड बटन: बोलने के बजाय संदेश टाइप या पेस्ट करने के लिए कीबोर्ड खोलता है। देखें टाइप करना।
- साफ़ करें बटन: मौजूदा संदेश साफ़ करता है। साफ़ किया गया संदेश पिछला में नहीं सहेजा जाता। साफ़ करें बटन को देर तक दबाने पर “नया सत्र शुरू करें?” डायलॉग आता है, जो ऐप को रीसेट कर देता है।
- पिछला: स्क्रीन के नीचे पूरे किए गए संदेशों की एक पट्टी। नया संदेश शुरू करने पर बिना साफ़ किया संदेश पिछला अनुभाग में जुड़ जाता है। किसी संदेश को फिर से दिखाने के लिए उस पर टैप करें। ऐप बंद होने पर पिछला साफ़ हो जाता है, और फुसफुसाहट मोड चालू रहने या Solo सत्र चलने के दौरान यह निष्क्रिय रहता है।
- ज़ोर से पढ़ें बटन: सेटिंग्स में चुनी गई आवाज़ से मौजूदा संदेश को ज़ोर से पढ़ता है। देखें ज़ोर से पढ़ें।
- सेटिंग्स बटन: सेटिंग्स स्क्रीन खोलता है, जहाँ भाषा, रंग योजना, बोलने की गति और फुसफुसाहट मोड जैसी प्राथमिकताएँ सेट की जाती हैं। देखें सेटिंग्स।
बोलना और डिक्टेशन
माइक्रोफ़ोन बटन पर टैप करके या संदेश प्रदर्शन क्षेत्र पर डबल-टैप करके डिक्टेशन शुरू करें। सामान्य रूप से बोलें; शब्द बोलते ही दिखने लगते हैं। यदि डिक्टेशन ठीक से काम न कर रहा हो (वाक्य ठीक से समाप्त न हो रहे हों), तो सेटिंग्स मेन्यू में तेज़ या धीमे बोलने वालों के लिए बोलने की गति सेटिंग है, जो मदद कर सकती है।
डिफ़ॉल्ट रूप से, लगभग एक सेकंड का ठहराव एक वाक्य समाप्त करता है, फिर dicto पूर्णविराम या प्रश्नचिह्न जोड़ता है और सुनता रहता है। लगभग दो सेकंड का ठहराव मौजूदा बारी समाप्त करता है और अंतिम टेक्स्ट दिखाता है; जो संदेश मुख्य स्क्रीन से नीचे तक जाते हैं वे अपने आप स्क्रॉल होते हैं। संदेशों को हाथ से भी स्क्रॉल किया जा सकता है, और सेटिंग्स मेन्यू में ऑटो-स्क्रॉलिंग बंद की जा सकती है। dicto ठहरावों पर कितनी देर रुके, इसे सेटिंग्स में बोलने की गति से समायोजित करें। Solo सत्र लगभग डेढ़ मिनट बाद अपने आप रुक जाता है, ताकि शोरगुल वाले कमरे में माइक्रोफ़ोन खुला न रह जाए। Solo के वाक्य-समय भी बोलने की गति सेटिंग से ही तय होते हैं।
डिक्टेशन Apple की वाक् पहचान से मिलता है और यह पूर्ण नहीं है। लहजे, पृष्ठभूमि का शोर, कम प्रचलित नाम, बहुत छोटे वाक्यांश और एक-दूसरे के ऊपर बोलते लोग ग़लत सुने जा सकते हैं। स्वाभाविक गति से साफ़ बोलना, और वक्ता से मेल खाती बोलने की गति सेटिंग का उपयोग करना, सबसे अच्छे नतीजे देता है।
स्क्रीन पर मौजूद टेक्स्ट साफ़ करने के लिए स्क्रीन के नीचे दिए साफ़ करें को दबाएँ। साफ़ करें को दबाकर रखने पर नया सत्र शुरू करें? डायलॉग आता है। dicto को रीसेट करने और पिछला अनुभाग साफ़ करने के लिए नए सिरे से शुरू करें दबाएँ।
Solo
Solo वॉयस आइसोलेशन तकनीक से dicto को एक दर्ज आवाज़ पर केंद्रित करता है, ताकि उसी वक्ता के शब्द दिखें और आस-पास की दूसरी आवाज़ें अनदेखी रहें। Solo बिना हाथ लगाए काम करने देता है। दूसरी आवाज़ों की बात न दिखाई जाती है और न कभी टेक्स्ट में बदली जाती है। Solo तब सबसे अच्छा काम करता है जब शांत से मध्यम शोर वाले कमरे में एक बार में एक ही व्यक्ति बोल रहा हो; जब dicto को यक़ीन न हो कि आवाज़ दर्ज वाली ही है, तो वह कुछ नहीं दिखाता। जल्दी में कहे गए तीन शब्दों से छोटे वाक्यांश पहचाने जाने के लिए बहुत छोटे हो सकते हैं (जैसे “Hello”, “That's great”), और स्क्रीन पर नहीं आ सकते।
Solo कैसे काम करता है
जब Solo सक्रिय होता है, dicto कमरे को सुनता है और बोली गई हर कड़ी को संख्याओं के एक छोटे समूह में बदल देता है, जो शब्दों को नहीं बल्कि आवाज़ की ध्वनि को बताता है। इन संख्याओं की तुलना आवाज़ दर्ज करते समय ली गई संख्याओं से की जाती है। जो बात दर्ज आवाज़ से मेल खाती है, उसे टेक्स्ट में बदलकर दिखाया जाता है; जो मेल नहीं खाती, उसे टेक्स्ट में बदले बिना ही हटा दिया जाता है। यह तुलना छोटे मशीन-लर्निंग मॉडल पर चलती है जो ऐप के भीतर ही आते हैं और पूरी तरह डिवाइस पर चलते हैं; इसमें कोई क्लाउड सेवा, खाता या कनेक्शन शामिल नहीं है। कोई भी बात कभी रखी या रिकॉर्ड नहीं की जाती।
आवाज़ दर्ज करना
- माइक्रोफ़ोन बटन दबाए रखें और स्वाभाविक रूप से बोलें। दबाए रखने के दौरान आप जो कहते हैं वह एक सामान्य संदेश के रूप में दिखता है।
- एक पैनल दर्ज करने की प्रगति दिखाता है। जब तक बुनियादी छँटाई के लिए पर्याप्त आवाज़ नहीं मिल जाती, पट्टी लाल रहती है।
- वास्तविक बोलने के लगभग तीन सेकंड पर पट्टी पीली हो जाती है और एक ध्वनि बजती है: बुनियादी दर्ज करना सफल हो गया है, और बटन कभी भी छोड़ा जा सकता है।
- बटन दबाए रखना जारी रखने से दर्ज आवाज़ बेहतर होती है, पूरी तरह दर्ज करने के लिए वास्तविक बोलने के दस सेकंड तक। जैसे-जैसे और आवाज़ मिलती है, पट्टी पीले से हरे की ओर बढ़ती है और लगभग दस सेकंड पर हरी हो जाती है। पूरी तरह दर्ज होने का संकेत Solo Glow है, जो पूरी स्क्रीन पर फैली चमक का प्रभाव है।
- बटन छोड़ दें। Solo दर्ज आवाज़ को सुनना शुरू कर देता है। दर्ज करना सफल होने का संकेत यह है कि माइक्रोफ़ोन आइकन बदलकर Solo आइकन बन जाता है: ध्वनि-पट्टियों वाले व्यक्ति का आइकन, जिसके चारों ओर ठोस फ़िरोज़ी गोल रेखा होती है।
यदि बटन छोड़ते समय बहुत कम आवाज़ मिली हो, तो dicto लगभग दो सेकंड और सुनता है, और यदि तब भी दर्ज करना पूरा न हो सके तो मौजूदा प्रक्रिया रद्द कर देता है।
दर्ज आवाज़ की पूर्ति और Solo Glow
शुरू करने के लिए बुनियादी दर्ज करना ही काफ़ी है, और dicto बाक़ी काम चुपचाप ख़ुद पूरा कर लेता है। सत्र के दौरान, बोली गई वे कड़ियाँ जो निस्संदेह दर्ज आवाज़ से मेल खाती हैं, दर्ज आवाज़ में जुड़ती जाती हैं, जिससे बातचीत बढ़ने के साथ सटीकता बेहतर होती है। इसे दर्ज आवाज़ की पूर्ति कहा जाता है; यह केवल दर्ज आवाज़ का ही उपयोग करती है, किसी और की बात का नहीं। जब दर्ज आवाज़ अपने पूरे आकार तक पहुँचती है, चाहे बटन को हरी पट्टी तक दबाए रखकर या बातचीत के दौरान पूर्ति से, तब Solo Glow दिखता है: एक संक्षिप्त, मौन, पूरी स्क्रीन पर फैली चमक, जिसका अर्थ है कि dicto ने आवाज़ पूरी तरह दर्ज कर ली है। इसके दिखने पर कुछ करने की ज़रूरत नहीं।
सत्र के दौरान
दर्ज आवाज़ एक बार में एक संदेश के रूप में दिखाई जाती है, बोलने की गति के समय के अनुसार। दूसरी आवाज़ों से स्क्रीन पर कुछ नहीं आता। Solo सत्र चालू रहने के दौरान पिछला छिपा रहता है। सुनना रोकने या फिर शुरू करने के लिए माइक्रोफ़ोन बटन पर टैप करें; कमरे में लगभग तीस सेकंड की ख़ामोशी के बाद सत्र अपने आप भी रुक जाता है। रुके हुए Solo सत्र का संकेत यह है कि ठोस फ़िरोज़ी रेखा टूटी हुई रेखा में बदल जाती है। मौजूदा सत्र फिर से चालू करने के लिए Solo बटन पर टैप करें।
सत्र समाप्त करना
मौजूदा टेक्स्ट और दर्ज आवाज़ मिटाने के लिए साफ़ करें बटन दबाए रखें और नए सिरे से शुरू करें की पुष्टि करें; “सत्र साफ़ कर दिया गया” का एक संक्षिप्त संदेश मिटने की पुष्टि करता है। दर्ज आवाज़ के बिना लगभग तीन मिनट बीतने पर, या ऐप के बैकग्राउंड में जाने पर भी सत्र अपने आप समाप्त हो जाता है। सत्र के दौरान माइक्रोफ़ोन बटन दबाए रखने पर दर्ज आवाज़ की जगह कोई दूसरी आवाज़ दर्ज की जा सकती है।
आवाज़ प्रोफ़ाइल
आवाज़ मिलान छोटे मशीन-लर्निंग मॉडल पर चलता है जो ऐप के भीतर ही आते हैं और पूरी तरह आपके डिवाइस पर चलते हैं। इसमें कोई क्लाउड सेवा, कोई खाता और कोई कनेक्शन शामिल नहीं है; ये मॉडल आवाज़ों की तुलना करते हैं, बस इतना ही। दर्ज आवाज़ का रिकॉर्ड स्वयं संख्याओं का एक छोटा समूह है जिससे आवाज़ पहचानी जाती है, और वह सत्र भर मेमोरी में रहता है: कभी सहेजा नहीं जाता, कहीं भेजा नहीं जाता, और सत्र समाप्त होते ही ख़त्म हो जाता है।
आवाज़ मिलान के मॉडल pyannote community-1 स्पीकर मॉडल (WeSpeaker परिवार) हैं, जिन्हें FluidInference ने Core ML में बदला है और जिनका उपयोग Creative Commons Attribution 4.0 लाइसेंस के तहत किया जाता है।
टाइप करना
टेक्स्ट टाइप करें खोलने के लिए कीबोर्ड बटन पर टैप करें। संदेश टाइप करें या पेस्ट करें, फिर उसे मुख्य स्क्रीन पर दिखाने के लिए हो गया पर टैप करें (या कीबोर्ड पर नीला, चेक बटन दबाएँ), या मौजूदा संदेश बदले बिना बंद करने के लिए रद्द करें पर टैप करें।
फुसफुसाहट मोड
फुसफुसाहट मोड गायब होने वाले संदेशों की सुविधा को चालू/बंद करता है। Wisps भेजने के लिए सेटिंग्स में फुसफुसाहट मोड चालू करें: ऐसे संदेश जो स्क्रीन पर आते हैं, कुछ सेकंड रहते हैं, फिर हमेशा के लिए मिट जाते हैं। Wisps कभी पिछला में सहेजे नहीं जाते, जो फुसफुसाहट मोड चालू रहने के दौरान छिपा रहता है। फुसफुसाहट मोड चालू रहने के दौरान ऑटो-स्क्रॉल भी बंद हो जाता है।
ज़ोर से पढ़ें
फ़िलहाल दिख रहे संदेश को ज़ोर से पढ़वाने के लिए ऊपर दाएँ कोने में ज़ोर से पढ़ें बटन पर टैप करें। स्क्रीन पर कोई संदेश न होने पर यह बटन उपलब्ध नहीं होता। पढ़ने वाली आवाज़ सेटिंग्स में आवाज़ के अंतर्गत तय होती है; और आवाज़ें iOS सेटिंग्स ऐप में ऐक्सेसिबिलिटी ▸ बोली जाने वाली सामग्री ▸ आवाज़ें से जोड़ी जा सकती हैं (Siri नहीं)।
सेटिंग्स
सेटिंग्स मेन्यू खोलने के लिए सेटिंग्स बटन (ऊपर बाईं ओर गियर) पर टैप करें।
- फुसफुसाहट मोड: गायब होने वाले संदेश चालू/बंद करता है। देखें फुसफुसाहट मोड।
- बोलने की गति: तेज़, औसत या धीमा। यह समायोजित करता है कि dicto वाक्य या संदेश समाप्त करने के लिए ठहरावों पर कितनी देर प्रतीक्षा करे। यदि वाक्य अलग न हों, तो तेज़ पर सेट करें; यदि वाक्य कट जाएँ, तो धीमा पर सेट करें।
- Solo आवाज़ मिलान: सख़्त, संतुलित या लचीला। यह समायोजित करता है कि Solo में दिखने के लिए किसी आवाज़ को दर्ज आवाज़ से कितना मेल खाना चाहिए। अगली बार आवाज़ दर्ज करने से लागू होता है। कमरे में आवाज़ें एक जैसी लगें तो सख़्त चुनें।
- बातचीत की दूरी (केवल iPad): पास (छोटा फ़ॉन्ट) और दूर (बड़ा फ़ॉन्ट) बातचीत के लिए फ़ॉन्ट आकार समायोजित करती है।
- लंबे संदेशों को स्वतः स्क्रॉल करें: चालू होने पर लंबे संदेश पढ़ने योग्य गति से अपने आप अंत तक स्क्रॉल होकर वापस आते हैं; बंद करने पर संदेशों का स्वतः स्क्रॉल होना रुक जाता है। संदेशों को हाथ से हमेशा स्क्रॉल किया जा सकता है।
- खुलने पर इनपुट: बोलकर, पहले संदेश के लिए dicto को सुनने वाले मोड में खोलता है, जैसे कोई त्वरित बातचीत साथी; मैन्युअल, dicto को सामान्य इंटरफ़ेस के साथ खोलता है, जिससे पहले संदेश को बोलकर या टेक्स्ट से इनपुट किया जा सकता है।
- आवाज़: ज़ोर से पढ़ें के लिए उपयोग की जाने वाली आवाज़।
- रंग योजना: पसंदीदा प्रदर्शन रंग चुनें। सिस्टम, हल्का और गहरा विकल्प, साथ ही हाई-कॉन्ट्रास्ट जोड़े: सफ़ेद पर काला, काले पर सफ़ेद, नीले पर पीला, काले पर हरा, काले पर नारंगी, सफ़ेद पर क्रिमसन, काले पर नियॉन गुलाबी, और हरे पर सफ़ेद। हर रंग संयोजन कॉन्ट्रास्ट के लिए WCAG AA ऐक्सेसिबिलिटी मानक पर खरा उतरता है, और dicto जिन बड़े आकारों में दिखाता है उन पर हर संयोजन AAA पर खरा उतरता है।
- भाषा: वह भाषा जो आप डिक्टेशन के लिए बोलते हैं (ऐप की भाषा नहीं)। dicto, Apple के ऑन-डिवाइस डिक्टेशन से ली गई 50+ बोली जाने वाली भाषाओं का समर्थन करता है। जब तक डिवाइस समर्थन करता है, कोई भी भाषा चुनी और उपयोग की जा सकती है, चाहे उपयोगकर्ता इंटरफ़ेस की भाषा कुछ भी हो (जैसे अंग्रेज़ी भाषा वाले ऐप इंटरफ़ेस में चीनी डिक्टेशन उपयोग किया जा सकता है)। डिक्टेशन भाषाओं की सूची देखें। dicto का इंटरफ़ेस स्वयं 14 भाषाओं में उपलब्ध है; इंटरफ़ेस भाषाएँ देखें।
- dicto के बारे में: ऐप संस्करण, एक संक्षिप्त विवरण, और इस साइट का लिंक।
गोपनीयता और डेटा
dicto सब कुछ आपके डिवाइस पर प्रोसेस करता है। आप जो कहते या टाइप करते हैं उसमें से कुछ भी हमें नहीं भेजा जाता, और ऐप बंद करने के बाद कुछ भी संग्रहीत नहीं होता। पूरे विवरण के लिए, गोपनीयता नीति देखें।
सहायता
सवाल, समस्याएँ या सुझाव? support@speechdisplay.com पर ईमेल करें, हमें मदद करके ख़ुशी होगी।