Transcrire un audio
Convertissez la voix en texte avec l'IA (Whisper)
Aucune base de données : AIMRAN ne conserve ni vos fichiers, ni vos textes, ni vos résultats
Qu’est-ce que Transcrire un audio ?
Cet outil transforme ce qui est dit dans un audio ou une vidéo en texte écrit : interviews, cours, réunions, messages vocaux ou vidéos pour lesquelles il vous faut des sous-titres.
Il utilise Whisper, un modèle d’intelligence artificielle de reconnaissance vocale. Vous pouvez choisir entre un mode rapide et un mode plus précis, et télécharger le résultat en texte ou en fichier de sous-titres avec le minutage de chaque phrase.
Mode d’emploi
- Importez l’audio ou la vidéo à transcrire.
- Choisissez le modèle : Rapide ou Précis.
- Choisissez la langue : Automatique, Espagnol ou Anglais.
- Cliquez sur Transcrire et attendez la fin.
- Copiez ou téléchargez le texte, ou téléchargez les sous-titres en SRT ou VTT.
Avantages
- Reconnaissance vocale avec Whisper, en deux tailles selon que vous privilégiez la vitesse ou la précision.
- Sous-titres SRT et VTT minutés, prêts pour la vidéo.
- Accepte l’audio et la vidéo dans les formats courants.
- Gratuit, sans inscription et sans limite d’utilisation.
Détails techniques
La transcription utilise les modèles Whisper tiny (environ 45 Mo) et Whisper base (environ 80 Mo) d’onnx-community, quantifiés sur 8 bits et exécutés avec Transformers.js, avec accélération WebGPU quand elle est disponible et CPU (WASM) sinon. Le modèle n’est téléchargé que la première fois. L’audio est décodé, mixé en mono et rééchantillonné à 16 kHz, l’entrée attendue par Whisper. La langue peut être détectée automatiquement ou fixée sur l’espagnol ou l’anglais. On obtient le texte complet et des segments avec début et fin, exportables en TXT, SubRip (.srt) et WebVTT (.vtt). Les audios de moins de 0,3 s ne sont pas traités. Limite de 300 Mo par fichier ; les audios longs peuvent prendre plusieurs minutes.
Questions fréquentes
Comment transcrire un audio en texte gratuitement ?
Importez l’audio, choisissez le modèle et la langue, puis cliquez sur Transcrire. À la fin, vous pourrez copier le texte ou le télécharger en TXT.
Puis-je créer des sous-titres pour une vidéo ?
Oui. Importez la vidéo, transcrivez-la et téléchargez le fichier SRT ou VTT, qui inclut le minutage de chaque phrase.
Quelle différence entre le modèle Rapide et le modèle Précis ?
Rapide utilise Whisper tiny : téléchargement plus léger et résultat plus tôt, avec un peu moins de précision. Précis utilise Whisper base : il est plus lent, mais se trompe moins.
Dans quelles langues fonctionne-t-il ?
Vous pouvez fixer l’espagnol ou l’anglais, ou laisser Automatique pour que le modèle détecte la langue.
Pourquoi est-ce plus long la première fois ?
Parce que le modèle d’IA (45 ou 80 Mo) est téléchargé. Les fois suivantes, il est déjà disponible et démarre plus vite.
Plus d’outils : Audio
- Convertir un audio · MP3, WAV, OGG, M4A et FLAC
- Compresser un audio · Réduisez le poids en ajustant le débit
- Couper un audio · Avec forme d'onde visuelle
- Fusionner des audios · Assemblez plusieurs pistes en une
- Volume et normalisation · Montez, baissez ou normalisez le niveau
- Dictaphone · Enregistrez depuis le micro et téléchargez