फ़्री टूल · आपके डिवाइस पर
ऑडियो और वीडियो को फ़्री में टेक्स्ट में ट्रांसक्राइब करें
ऑडियो या वीडियो फ़ाइल में जो कहा गया है उसे टेक्स्ट में बदलें: वॉइस नोट, इंटरव्यू, लेक्चर या पॉडकास्ट एपिसोड। ट्रांसक्रिप्शन आपके डिवाइस पर Whisper से चलता है; टेक्स्ट जाँचें, कॉपी करें या TXT (पैराग्राफ़ में या टाइमस्टैम्प के साथ) या SRT के रूप में डाउनलोड करें।
- फ़्री, फ़्री अकाउंट ज़रूरी
- TXT और SRT
- आपका ऑडियो आपके डिवाइस से बाहर नहीं जाता
- अपना ऑडियो या वीडियो जोड़ें
- ट्रांसक्राइब करें
- जाँचें और डाउनलोड करें
इसे कैसे इस्तेमाल करें
तीन चरण।
अपना ऑडियो या वीडियो जोड़ें
बोलचाल वाले MP3, WAV, M4A, OGG, MP4, WebM या MOV, 10 मिनट तक। भाषा चुनें: स्पैनिश, अंग्रेज़ी या ऑटो-डिटेक्ट।
ट्रांसक्राइब करें
“Transcribe to text” दबाएँ। पहली बार मॉडल डाउनलोड होता है; उसके बाद हाल के कंप्यूटर पर इसमें लगभग उतना ही समय लगता है जितनी ऑडियो है।
जाँचें और डाउनलोड करें
टेक्स्ट ठीक करें, उसे कॉपी करें या TXT को पैराग्राफ़ में या टाइमस्टैम्प के साथ डाउनलोड करें, और SRT को वाक्य के हिसाब से।
अगला क़दम
इन टूल के साथ आगे बढ़ते रहें
टेक्स्ट में ट्रांसक्राइब करें: अक्सर पूछे जाने वाले सवाल
ट्रांसक्रिप्शन कितना सटीक है?
साफ़ बोली और कम शोर में यह आमतौर पर ज़्यादातर शब्द सही पकड़ लेता है। यह नामों, बैकग्राउंड म्यूज़िक, तेज़ लहजे या एक-दूसरे पर चढ़ती आवाज़ों में गलती कर सकता है, और यह वक्ताओं को अलग नहीं पहचानता। इस्तेमाल से पहले टेक्स्ट जाँच लें।
क्या यह WhatsApp वॉइस नोट के साथ काम करता है?
हाँ, अगर आपका ब्राउज़र फ़ाइल चला सके (वॉइस नोट आमतौर पर OGG या OPUS होते हैं, जिन्हें Chrome, Edge और Firefox पढ़ते हैं)। उसे अपने डिवाइस पर सहेजें और यहाँ जोड़ें।
अगर मेरा ऑडियो 10 मिनट से लंबा हो तो?
इसे 10 मिनट तक के हिस्सों में काटें और एक-एक करके ट्रांसक्राइब करें। 15 मिनट तक की ऑडियो फ़ाइल यहीं हमारे MP3 कटर से काटी जा सकती है; वीडियो या लंबी ऑडियो फ़ाइल अपने फ़ोन की गैलरी या अपने एडिटर में काटें (वीडियो ट्रिम करें भी 10 मिनट पर रुक जाता है)। यह सीमा फ़ोन पर भी इसे अच्छे से चलने देती है।
ट्रांसक्रिप्शन कौन करता है?
Whisper (OpenAI का स्पीच रिकॉग्निशन मॉडल, MIT-लाइसेंस वाले वेट) जो आपके ब्राउज़र के भीतर transformers.js (Apache 2.0 लाइसेंस) से चलता है, वही जो हमारे ऑटो सबटाइटल टूल में इस्तेमाल होता है। पहली बार मॉडल डाउनलोड होता है (“Normal” में लगभग 77 MB और “High” में लगभग 250 MB) और आपका ब्राउज़र उसे सहेज लेता है।
क्या मेरी ऑडियो किसी सर्वर पर अपलोड होती है?
नहीं। ऑडियो आपके ब्राउज़र के अंदर पढ़ी और ट्रांसक्राइब की जाती है और Cocuyo या किसी थर्ड पार्टी को नहीं भेजी जाती। सिर्फ़ स्पीच मॉडल हमारे सर्वर से एक बार डाउनलोड होता है।
क्या यह सच में फ़्री है?
हाँ। आप साइन अप करने से पहले इसे आज़मा सकते हैं; इसे इस्तेमाल करते रहने के लिए हम एक मुफ़्त अकाउंट माँगते हैं, सब्सक्रिप्शन के बिना। इसमें क्रेडिट नहीं लगते और यह आपके 30 वेलकम इस्तेमाल में नहीं गिना जाता: इस्तेमाल की कोई सीमा नहीं।
सीमाएँ क्या हैं?
300 MB और 10 मिनट तक की एक ऑडियो या वीडियो फ़ाइल जिसे आपका ब्राउज़र चला सके। ट्रांसक्रिप्शन डिवाइस पर चलता है: फ़ोन पर इसमें कंप्यूटर से बहुत ज़्यादा समय लग सकता है।
सीखें कि कैसे…
और फ़्री टूल
दूसरे ऑडियो टूल
सभी फ़्री टूल
जब आप बनाना चाहते हैं
AI से आवाज़ें और नैरेशन बनाएँ।
Cocuyo का स्टूडियो इमेज, वीडियो और आवाज़ के 30 से ज़्यादा AI मॉडल एक साथ लाता है। जनरेट करने से पहले आप क्रेडिट की लागत देखते हैं, और क्रेडिट कभी एक्सपायर नहीं होते।