Hear2Text
भाषण करने वालों की पहचान

ऑडियो में स्पीकर अपने-आप पहचानें

मीटिंग, इंटरव्यू या पॉडकास्ट अपलोड कीजिए, Hear2Text ऑडियो को टेक्स्ट में बदलकर हर लाइन पर उसका स्पीकर लिखता है: Speaker 1, Speaker 2 वगैरह, संख्या की कोई सीमा नहीं, हर प्लान पर। नाम बदलना और स्पीकर मिलाना, साथ ही उन्हें अपने एक्सपोर्ट में जोड़ना, पेड Monthly और Yearly प्लान में शामिल है।

हर आवाज़ का एक लेबल, शुरू से आखिर तक

पूरी रिकॉर्डिंग एक ही बार में ट्रांसक्राइब होती है, इसलिए जो आवाज़ पहले मिनट में Speaker 2 है, वह एक घंटे बाद भी Speaker 2 ही रहती है। ट्रांसक्रिप्ट की हर लाइन पर उसका स्पीकर और टाइमस्टैम्प होता है; लाइन पर क्लिक कीजिए, प्लेयर उसी पल पर पहुंचेगा और आप जांच सकेंगे कि असल में किसने कहा। पेड प्लान पर आप लेबल को असली नाम दे सकते हैं और एक ही व्यक्ति के दो लेबल मिला सकते हैं; मॉडल की गलती होने पर कोई भी लाइन दूसरे स्पीकर पर ले जाना हर प्लान पर होता है।

शुरू करें

देखिए बातचीत किसके हिस्से कितनी रही

स्पीकर पैनल दिखाता है कि रिकॉर्डिंग में हर व्यक्ति का कितना हिस्सा है, ताकि एक नज़र में दिखे कि इंटरव्यू लेने वाला मेहमान से ज़्यादा बोला या मीटिंग में किसी एक की आवाज़ हावी रही। Hear2Text आवाज़ें सिर्फ़ एक रिकॉर्डिंग के भीतर अलग करता है; वह रिकॉर्डिंग के बीच आवाज़ें याद नहीं रखता और न पहचानता है कि कोई कौन है, इसलिए नाम हमेशा आप ही जोड़ते हैं।

शुरू करें

कई लोगों वाला ऑडियो, स्पीकर लेबल के साथ और बिना

कार्यबिनाHear2Text के साथ
कई लोगों वाली मीटिंगटेक्स्ट का एक लंबा टुकड़ा, पता नहीं किसने क्या कहाहर लाइन पर Speaker 1, Speaker 2 वगैरह
इंटरव्यू ट्रांसक्रिप्टसवाल और जवाब आपस में घुल-मिल जाते हैंइंटरव्यू लेने वाला और मेहमान अलग लेबल पर, नाम बदलने लायक
पॉडकास्ट शो नोट्सहोस्ट और मेहमान पहचानने के लिए एपिसोड दोबारा सुननापैनल जो दिखाए कि एपिसोड में कौन कितना बोला
कोई उद्धरण ढूंढनाकान लगाकर ऑडियो आगे-पीछे करनाट्रांसक्रिप्ट में खोजिए, लाइन पर क्लिक कीजिए, सुनिए

उपयोग के मामले

  • टीम मीटिंग

    देखिए हर बात किसने उठाई और किसने किस पर हामी भरी। स्पीकर को साथियों के नाम दीजिए और मिनट्स लिखने से पहले लाइन पर क्लिक करके दोबारा सुनिए।

  • इंटरव्यू और पॉडकास्ट

    होस्ट और मेहमान को अलग रखिए, ताकि एपिसोड दोबारा सुने बिना उद्धरण निकालें और शो नोट्स लिखें। स्पीकर पैनल दिखाता है कि कौन कितना बोला।

  • शोध साक्षात्कार और फ़ोकस ग्रुप

    ग्रुप सेशन में प्रतिभागियों को अलग कीजिए और देखिए कि हर किसी ने क्या कहा। एक माइक पर कई मिलती-जुलती आवाज़ें हों तो कुछ लाइनें हाथ से सुधारनी पड़ेंगी।

स्पीकर पहचान कैसे काम करती है

आप फ़ाइल अपलोड करते हैं या पब्लिक लिंक पेस्ट करते हैं। रिकॉर्डिंग एक ही बार में ट्रांसक्राइब होकर आवाज़ के हिसाब से बंटती है, फिर आप ब्राउज़र में लेबल ठीक करते हैं। न सेटअप, न आवाज़ के नमूने, न भाषा चुनना।

  1. चरण 01

    रिकॉर्डिंग अपलोड कीजिए

    500 MB और 6 घंटे तक का ऑडियो या वीडियो अपलोड कीजिए, या YouTube, Vimeo या Zoom क्लाउड रिकॉर्डिंग का पब्लिक शेयर लिंक पेस्ट कीजिए। भाषा अपने-आप पहचानी जाती है।

  2. चरण 02

    आवाज़ें अलग की जाती हैं

    पूरी रिकॉर्डिंग का एक साथ विश्लेषण होता है, इसलिए स्पीकर के बीच की बारियां मिलती हैं और हर आवाज़ पूरे समय एक ही लेबल पर रहती है।

  3. चरण 03

    लाइनों को स्पीकर लेबल मिलते हैं

    हर लाइन पर Speaker 1, Speaker 2 वगैरह लिखा होता है, उसके टाइमस्टैम्प के साथ। सिर्फ़ एक आवाज़ हो तो लेबल छिपा रहता है।

  4. चरण 04

    नाम बदलिए और ठीक कीजिए

    पेड प्लान पर स्पीकर को असली नाम दीजिए और दोहराए गए लेबल मिलाइए। कोई भी लाइन सही व्यक्ति पर ले जाना हर प्लान पर होता है।

मुख्य विशेषताएं

  • स्पीकर की अपने-आप पहचान

    स्पीकर ऑडियो से ही पहचाने जाते हैं। न कुछ टैग करना, न आवाज़ के नमूने, न पहले से स्पीकर की गिनती बतानी।

  • स्पीकर का नाम बदलें और मिलाएं

    पेड प्लान पर Speaker 1 को एक कदम में "अनीता" बनाइए, और एक ही व्यक्ति के दो लेबल मिला दीजिए।

  • पूरी रिकॉर्डिंग में एक-सा

    पूरी फ़ाइल पर एक ही बार काम होता है, इसलिए हर आवाज़ पहले मिनट से आखिरी तक एक ही लेबल पर रहती है।

  • कितने भी स्पीकर

    स्पीकर की कोई सीमा नहीं: दो लोगों का इंटरव्यू, टीम मीटिंग और पैनल, सब चलते हैं। साफ़ ऑडियो में आवाज़ें सबसे अच्छी तरह अलग होती हैं।

  • लाइनें हाथ से ठीक कीजिए

    एक साथ बोलना और मिलती-जुलती आवाज़ें गलतियां कराती हैं। कोई भी लाइन दूसरे स्पीकर पर ले जाइए और ब्राउज़र में टेक्स्ट एडिट कीजिए।

  • स्पीकर अब आपके डाउनलोड में भी

    पेड प्लान पर, डाउनलोड करते समय स्पीकर जोड़ना चुनिए: TXT, Word और PDF हर बारी को स्पीकर के नाम से शुरू करते हैं, और SRT व VTT हर सबटाइटल से पहले नाम रखते हैं।

अक्सर पूछे जाने वाले प्रश्न

यह कितने स्पीकर पहचान सकता है?
कोई तय सीमा नहीं है। Hear2Text जितनी अलग आवाज़ें पाता है, सबको लेबल देता है, Speaker 1, Speaker 2, Speaker 3 और आगे, चाहे दो लोगों की फ़ोन कॉल हो या आठ लोगों का पैनल। मिलती-जुलती आवाज़ों वाले ज़्यादा स्पीकर अलग करना कठिन बनाते हैं, इसलिए एक माइक पर रिकॉर्ड बड़े समूह में कुछ लाइनें हाथ से खिसकानी पड़ सकती हैं। जब सिर्फ़ एक व्यक्ति बोलता है, लेबल छिपा रहता है।
क्या पहले स्पीकर रजिस्टर करने या आवाज़ के नमूने अपलोड करने होंगे?
नहीं। न कोई रजिस्ट्रेशन, न आवाज़ के नमूने रिकॉर्ड करने हैं। स्पीकर रिकॉर्डिंग से ही अलग पहचाने जाते हैं, इसलिए बस फ़ाइल अपलोड कीजिए या पब्लिक लिंक पेस्ट कीजिए, ट्रांसक्रिप्ट लेबल के साथ आएगा। Hear2Text नहीं जानता कि कौन कौन है, इसलिए उन्हें Speaker 1, Speaker 2 वगैरह कहता है; पेड प्लान पर आप बाद में नाम बदल सकते हैं।
स्पीकर पहचान कितनी सटीक है?
साफ़ रिकॉर्डिंग पर, जहां लोग बारी-बारी बोलें और हर किसी का अपना माइक हो, यह भरोसेमंद है। जब लोग एक-दूसरे के ऊपर बोलें, सब एक दूर रखे माइक पर हों, या दो आवाज़ें मिलती-जुलती हों, तो सटीकता घटती है। गलती आम तौर पर किसी छोटी लाइन के गलत व्यक्ति के नाम जाने के रूप में दिखती है, और आप ब्राउज़र में कोई भी लाइन सही स्पीकर पर ले जा सकते हैं या दो लेबल मिला सकते हैं।
क्या मैं स्पीकर को असली नाम दे सकता हूं?
हां, पेड प्लान पर। Speaker 1 का नाम "अनीता" कीजिए, उसकी हर लाइन एक साथ बदल जाएगी। अगर एक व्यक्ति दो लेबल में बंट गया हो, तो उन्हें मिला दीजिए। नाम आपके डाउनलोड में भी आ जाते हैं: एक्सपोर्ट करते समय स्पीकर जोड़ना चुनिए, और TXT, Word, PDF, SRT व VTT सभी उन्हें दिखाएंगे।
जब लोग एक-दूसरे के ऊपर बोलें तो क्या होता है?
एक साथ बोलना सबसे कठिन मामला है। हर सेगमेंट को एक ही स्पीकर मिलता है, इसलिए जब दो लोग एक साथ बोलें तो लाइन उसे जाती है जिसकी आवाज़ हावी हो, और बीच में टोकी गई छोटी बात छूट सकती है या गलत व्यक्ति से जुड़ सकती है। ज़्यादा एक साथ बोलने से ट्रांसक्रिप्शन की सटीकता भी घटती है। बाद में आप ब्राउज़र में टेक्स्ट एडिट करके और लाइनें सही स्पीकर पर ले जाकर इसे ठीक कर सकते हैं।
क्या यह कॉल रिकॉर्डिंग के साथ काम करता है?
हां, अगर रिकॉर्डिंग आपके पास फ़ाइल के रूप में है। उसे अपलोड कीजिए (500 MB और 6 घंटे तक, MP3, M4A, WAV या ज़्यादातर दूसरे फ़ॉर्मैट में), दोनों तरफ़ के लोगों को लेबल मिलेंगे। फ़ोन ऑडियो संकरा और दबा हुआ होता है, इसलिए स्टूडियो ऑडियो के मुकाबले आवाज़ें कम साफ़ अलग होती हैं, खासकर जब दोनों आवाज़ें मिलती-जुलती हों। Hear2Text खुद कॉल रिकॉर्ड नहीं करता और Zoom, Teams या Meet में कोई बॉट नहीं जुड़ता।

अपनी अगली रिकॉर्डिंग में स्पीकर पहचानिए

मीटिंग, इंटरव्यू या पॉडकास्ट अपलोड कीजिए और ऐसा ट्रांसक्रिप्ट पाइए जिसकी हर लाइन पर स्पीकर का लेबल हो, हर प्लान पर। स्पीकर को नाम देना और उन्हें अपने एक्सपोर्ट में जोड़ना Monthly ($9.99) और Yearly ($89.99) प्लान का हिस्सा है, जिनमें असीमित ट्रांसक्रिप्शन मिनट भी हैं।