गाइड

TXT, SRT, VTT, SBV, CSV, HTML या PDF — कौन-सा ट्रांसक्रिप्ट फ़ॉर्मैट?

सात एक्सपोर्ट विकल्प एक मेन्यू हैं, फ़ैसला नहीं। हर एक किसी अलग काम के लिए मौजूद है, और ग़लत चुनने पर एडिटर में एक दोपहर बर्बाद होती है।

ट्रांसक्रिप्शन टूल आम तौर पर एक्सपोर्ट फ़ॉर्मैट की सूची दे देते हैं, बिना यह बताए कि इनमें से कोई है किस काम का। यहाँ वह फ़ैसला है, पहले एक तालिका में और फिर विस्तार से।

आप चाहते हैं… तो इस्तेमाल कीजिए
उसे पढ़ना, संपादित करना, चिपकाना TXT
Premiere या Final Cut में वीडियो पर सबटाइटल लगाना SRT
वेब पर वीडियो पर सबटाइटल लगाना VTT
YouTube पर सबटाइटल अपलोड करना SRT (या SBV)
चीज़ें क्रमबद्ध करना, फ़िल्टर करना या गिनना CSV
उसे किसी पेज पर प्रकाशित करना HTML
उसे किसी ऐसे व्यक्ति को भेजना जो उसे संपादित न कर सके PDF

टेक्स्ट वाले #

TXT #

सिर्फ़ शब्द, कोई टाइमिंग नहीं। जिस चीज़ को आप पढ़ने या जिससे लिखने वाले हैं उसके लिए यही सही डिफ़ॉल्ट है — नोट्स में चिपकाना, किसी दस्तावेज़ में डालना, कोई वाक्यांश खोजना।

जानने लायक़ बात: TXT एक्सपोर्ट करते ही टाइमिंग चली जाती है। अगर ज़रा भी संभावना है कि आपको बाद में ऑडियो में वह क्षण ढूँढ़ना पड़ेगा, तो एक समयबद्ध फ़ॉर्मैट भी एक्सपोर्ट कीजिए। दोनों रखने में कुछ ख़र्च नहीं होता।

PDF #

एक स्थिर दस्तावेज़। इसका इस्तेमाल तब कीजिए जब ट्रांसक्रिप्ट कोई कामकाजी फ़ाइल न होकर सुपुर्द की जाने वाली चीज़ हो: ग्राहक को रिकॉर्ड भेजना, कुछ दाख़िल करना, किसी रिपोर्ट के साथ जोड़ना जहाँ वह हर मशीन पर एक जैसा दिखना चाहिए और यूँ ही संपादित नहीं होना चाहिए।

इसे अपनी कामकाजी प्रति के रूप में मत इस्तेमाल कीजिए। PDF से टेक्स्ट साफ़-सुथरे ढंग से वापस निकालना झंझट है।

HTML #

वेब पेज के रूप में ट्रांसक्रिप्ट। अगर ट्रांसक्रिप्ट प्रकाशित होने वाला है, तो आपको यही चाहिए — किसी ब्लॉग पर, किसी नॉलेज बेस में, किसी पॉडकास्ट एपिसोड के सुगम साथी के रूप में।

ट्रांसक्रिप्ट को HTML के रूप में प्रकाशित करने की वह वजह जिसे कम आँका जाता है: सर्च इंजन टेक्स्ट पढ़ते हैं, ऑडियो नहीं। प्रकाशित ट्रांसक्रिप्ट वाला पॉडकास्ट इस तरह खोजा जा सकता है जैसे कोई ऑडियो फ़ाइल कभी नहीं जा सकती, और यह किसी पॉडकास्ट के लिए उपलब्ध सबसे सस्ता सुगम्यता सुधार है।

सबटाइटल वाले #

ये तीनों एक ही काम करते हैं — वीडियो पर दिखाने के लिए टेक्स्ट और टाइमिंग — और क्षमता में नहीं, सिंटैक्स में फ़र्क रखते हैं।

SRT #

सर्वव्यापी फ़ॉर्मैट। हर वीडियो एडिटर, हर प्लेयर, हर प्लैटफ़ॉर्म इसे स्वीकार करता है। अगर आपको ठीक से पता न हो, तो जवाब यही है।

1
00:00:00,000 --> 00:00:07,000
Good afternoon everyone and welcome
to the second quarter earnings call.

क्रमांकित ब्लॉक, एक शुरुआती और एक अंतिम टाइमकोड, टेक्स्ट, एक खाली पंक्ति। मिलीसेकंड से पहले लगे कॉमा पर ध्यान दीजिए।

VTT (WebVTT) #

वेब मानक, और HTML5 वीडियो को यही अपेक्षित है। संरचना में SRT से लगभग एक जैसा, दो फ़र्क के साथ जो मायने रखते हैं: फ़ाइल WEBVTT पंक्ति से शुरू होती है, और टाइमकोड मिलीसेकंड से पहले कॉमा के बजाय फ़ुल स्टॉप इस्तेमाल करते हैं।

WEBVTT

00:00:00.000 --> 00:00:07.000
Good afternoon everyone and welcome
to the second quarter earnings call.

यही इकलौती सबसे आम सबटाइटल समस्या है जिससे लोग टकराते हैं: SRT का नाम बदलकर .vtt कर देना, या उल्टा। वह सही दिखता है और चुपचाप लोड होने में विफल हो जाता है। अगर सबटाइटल बिना किसी दिखते कारण के अस्वीकार हो रहे हों, तो सबसे पहले उसी अक्षर को जाँचिए।

VTT स्टाइलिंग और स्थिति-निर्धारण भी ले जा सकता है, जो SRT नहीं कर सकता — शायद ही कभी ज़रूरी होता है, कभी-कभार इसे चुनने की वजह बनता है।

SBV #

YouTube का अपना फ़ॉर्मैट, उस दौर का जब वह बाक़ी सब स्वीकार नहीं करता था। और भी सरल: कॉमा से अलग किए गए टाइमकोड, कोई ब्लॉक नंबर नहीं।

0:00:00.000,0:00:07.000
Good afternoon everyone and welcome
to the second quarter earnings call.

जब कोई वर्कफ़्लो ख़ास तौर पर इसकी अपेक्षा करे तब यह रखने लायक़ है। YouTube अब SRT बिल्कुल ठीक से स्वीकार करता है, इसलिए यह पहली पसंद नहीं बल्कि एक अनुकूलता विकल्प है।

विश्लेषण वाला #

CSV #

प्रति सेगमेंट एक पंक्ति, कॉलम के रूप में शुरू समय, अंत समय और टेक्स्ट। यही वह फ़ॉर्मैट है जिसे इस्तेमाल करने की बात किसी के दिमाग़ में नहीं आती और जो सबसे ज़्यादा संभावनाएँ खोलता है।

इसे Numbers, Excel या किसी Python नोटबुक में खोलिए और आप वे काम कर सकते हैं जो टेक्स्ट दस्तावेज़ में असंभव हैं:

  • सबसे लंबे अबाधित अंश ढूँढ़ने के लिए सेगमेंट को लंबाई के हिसाब से क्रमबद्ध कीजिए।
  • उद्धरण अनुक्रमणिका बनाने के लिए हर उस सेगमेंट को उसके टाइमस्टैंप सहित फ़िल्टर कीजिए जिसमें कोई ख़ास शब्द हो।
  • गिनिए कि ट्रांसक्रिप्ट के एक फ़ोल्डर भर में कोई विषय कितनी बार आता है।
  • शोध के लिए कई रिकॉर्डिंग के ट्रांसक्रिप्ट जोड़कर एक डेटासेट बनाइए।

अगर आप पढ़ने के लिए नहीं बल्कि विश्लेषण के लिए ट्रांसक्राइब कर रहे हैं — यूज़र रिसर्च, कंटेंट विश्लेषण, अनुपालन समीक्षा — तो अपने TXT के साथ CSV भी एक्सपोर्ट कीजिए।

दो व्यावहारिक नियम #

एक से ज़्यादा एक्सपोर्ट कीजिए। इन्हें बनाने में कुछ ख़र्च नहीं होता और ये अलग-अलग सवालों के जवाब देते हैं। TXT और एक समयबद्ध फ़ॉर्मैट लगभग हर संभावना को कवर कर लेते हैं।

इस पर कुछ खड़ा करने से पहले फ़ाइल जाँच लीजिए। स्वचालित ट्रांसक्रिप्ट में ग़लतियाँ होती हैं, और उन्हें ठीक करना इसी चरण पर सबसे सस्ता है। एडिटर में 400 कैप्शन इंपोर्ट करके उन्हें स्टाइल करना शुरू करने से पहले नाम और अंकों पर नज़र डाल लीजिए।

यह कहाँ से आता है #

Offline Transcription सातों एक्सपोर्ट करता है — TXT, SRT, SBV, VTT, CSV, HTML और PDF — Mac और iPhone दोनों पर, एक ही ट्रांसक्रिप्ट से, रिकॉर्डिंग कहीं अपलोड किए बिना।

अगर आपका लक्ष्य ख़ास तौर पर सबटाइटल है, तो हमारे पास SRT बनाने और उसे Final Cut, Premiere या YouTube में लोड करने की चरण-दर-चरण मार्गदर्शिका है।

Offline Transcription पाएं

ऑडियो और वीडियो को पूरी तरह अपने Mac पर ही ट्रांसक्राइब करें। कुछ भी अपलोड नहीं होता, कोई अकाउंट नहीं, और प्रति मिनट का कोई मीटर नहीं।

macOS 13.0 or higher · iOS 16.4 or higher