OUTIL GRATUIT · SUR VOTRE APPAREIL
Transcrire un audio ou une vidéo en texte gratuitement
Transformez ce qui est dit dans un fichier audio ou vidéo en texte : un message vocal, une interview, une conférence ou un épisode de podcast. La transcription s'exécute avec Whisper sur votre appareil ; vérifiez le texte, copiez-le ou téléchargez-le en TXT (par paragraphes ou avec horodatage) ou en SRT.
- Gratuit, compte gratuit requis
- TXT et SRT
- Votre audio ne quitte jamais votre appareil
- Ajoutez votre audio ou votre vidéo
- Transcrire
- Vérifiez et téléchargez
COMMENT L'UTILISER
Trois étapes.
Ajoutez votre audio ou votre vidéo
MP3, WAV, M4A, OGG, MP4, WebM ou MOV avec de la parole, jusqu'à 10 minutes. Choisissez la langue : espagnol, anglais ou détection automatique.
Transcrire
Appuyez sur « Transcrire en texte ». La première fois, le modèle se télécharge ; ensuite, cela prend à peu près la durée de l'audio sur un ordinateur récent.
Vérifiez et téléchargez
Corrigez le texte, copiez-le ou téléchargez le TXT en paragraphes ou avec horodatage, et le SRT par phrase.
ÉTAPE SUIVANTE
Continuez avec ces outils
Transcrire en texte : questions fréquentes
Quelle est la précision de la transcription ?
Avec une voix claire et peu de bruit, il trouve en général la plupart des mots. Il peut se tromper sur les noms, la musique de fond, les accents marqués ou les voix qui se chevauchent, et il ne distingue pas les locuteurs. Vérifiez le texte avant de l'utiliser.
Fonctionne-t-il avec les messages vocaux WhatsApp ?
Oui, si votre navigateur peut lire le fichier (les messages vocaux sont généralement en OGG ou OPUS, que Chrome, Edge et Firefox savent lire). Enregistrez-le sur votre appareil et ajoutez-le ici.
Et si mon audio dure plus de 10 minutes ?
Découpez-le en parties de 10 minutes maximum et transcrivez-les une par une. Un fichier audio jusqu’à 15 minutes peut être coupé directement ici avec notre découpeur MP3 ; coupez une vidéo ou un audio plus long dans la galerie de votre téléphone ou dans votre éditeur (Couper une vidéo s’arrête aussi à 10 minutes). La limite garantit un bon fonctionnement aussi sur téléphone.
Que fait la transcription ?
Whisper (le modèle de reconnaissance vocale d'OpenAI, aux poids sous licence MIT) exécuté par transformers.js (licence Apache 2.0) dans votre navigateur, le même que celui qu'utilise notre outil Sous-titres automatiques. La première fois, le modèle se télécharge (environ 77 Mo en « Normal » et environ 250 Mo en « Élevé ») et votre navigateur le conserve.
Mon audio est-il importé sur un serveur ?
Non. L'audio est lu et transcrit dans votre navigateur et n'est envoyé ni à Cocuyo ni à un tiers. Seul le modèle de reconnaissance vocale se télécharge, une fois, depuis nos serveurs.
Est-ce vraiment gratuit ?
Oui. Vous pouvez l’essayer avant de vous inscrire ; pour continuer à l’utiliser, nous vous demandons un compte gratuit, sans abonnement. Il n’utilise aucun crédit et ne compte pas dans vos 30 utilisations de bienvenue : son usage est sans limite.
Quelles sont les limites ?
Un fichier audio ou vidéo jusqu'à 300 Mo et 10 minutes que votre navigateur peut lire. La transcription s'exécute sur l'appareil : sur un téléphone, elle peut prendre bien plus de temps que sur un ordinateur.
Apprenez à…
PLUS D'OUTILS GRATUITS
Autres outils audio
Tous les outils gratuits
QUAND VOUS VOULEZ CRÉER
Créez des voix et des narrations avec l’IA.
Le Studio de Cocuyo réunit plus de 30 modèles IA d’image, de vidéo et de voix. Vous voyez le coût en crédits avant de générer, et les crédits n’expirent jamais.