▶ Vidéo · Mot-clé VOIX

Une voix off pro avec ta propre voix, sans micro et sans studio

WaveSpeed qwen3-tts·Voice cloning·Niveau débutant

Tu clones ta voix une seule fois à partir d'un court échantillon, puis tu génères autant de voix off que tu veux à partir d'un simple texte. Plus besoin de micro, de studio, ni de réenregistrer dix fois. C'est le workflow que j'utilise pour la narration de mes vidéos.

Ce que tu construis exactement

  • Un échantillon de référence de ta voix, enregistré une fois avec ton téléphone
  • Un appel API qui transforme n'importe quel texte en audio, dans ta voix
  • Un workflow n8n : tu envoies un texte, tu récupères un fichier MP3 prêt à monter

Un seul modèle fait le travail : WaveSpeed qwen3-tts voice-clone. Il prend ta voix de référence + ton texte, et rend l'audio.

Étape 1 — Enregistrer ta voix de référence

Enregistre 15 à 30 secondes de toi qui lis un texte au calme, dans une pièce silencieuse. Un mémo vocal de téléphone suffit largement. Parle naturellement, au rythme que tu veux pour tes voix off. Exporte en .mp3 ou .wav et héberge-le sur une URL publique (Drive, S3, ou ton propre serveur).

Règle non négociable

Ne clone que ta propre voix, ou une voix pour laquelle tu as un accord écrit. Cloner la voix de quelqu'un sans consentement est interdit par la loi et par les conditions de WaveSpeed — et ça se retourne toujours contre toi.

Étape 2 — Ta clé API WaveSpeed

Crée un compte sur wavespeed.ai, va dans API Keys et génère une clé. Tu l'utilises dans l'en-tête Authorization: Bearer. Teste que tout répond :

curl -X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen3-tts/voice-clone" \ -H "Authorization: Bearer TA_CLE_API" \ -H "Content-Type: application/json" \ -d '{ "reference_audio": "https://ton-domaine.com/ma-voix.mp3", "text": "Bonjour, ceci est un test de ma voix off générée par intelligence artificielle." }'

La réponse te renvoie un id de requête : la génération est asynchrone.

Étape 3 — Récupérer l'audio généré

Avec l'id reçu, interroge le résultat jusqu'à ce que le statut passe à completed :

curl -G "https://api.wavespeed.ai/api/v3/predictions/ID_DE_LA_REQUETE/result" \ -H "Authorization: Bearer TA_CLE_API" # Réponse quand c'est prêt : # { "status": "completed", "outputs": ["https://.../ta-voix-off.mp3"] }

Tu télécharges l'URL renvoyée : c'est ton fichier voix off, dans ta voix, prêt à poser sur une vidéo.

Étape 4 — Automatiser dans n8n

Pour ne plus jamais toucher à curl : un workflow n8n en quatre nœuds.

  • Webhook / Formulaire — tu colles ton texte
  • HTTP Request (POST) — envoie le texte + ta voix de référence au modèle
  • Wait + HTTP Request (GET) — attend puis récupère l'URL de l'audio
  • Google Drive / Telegram — dépose le MP3 là où tu le récupères

Stocke ta clé API et l'URL de ta voix de référence en variables, et tu génères une voix off en collant simplement ton texte.

Piège vu en production

Un échantillon de référence trop court, avec de la musique de fond ou de l'écho, donne une voix clonée « robotique ». La qualité de la sortie dépend entièrement de la qualité de l'échantillon : 20 secondes propres valent mieux qu'une minute bruitée. Réenregistre l'échantillon avant de blâmer le modèle.

Le workflow n8n, prêt à importer

Pas envie de tout recâbler à la main ? Télécharge le workflow complet (formulaire → clonage WaveSpeed → polling → livraison) et importe-le dans ton n8n. Il te reste juste à mettre ta clé API et ta livraison — tout est expliqué dans la note du workflow.

◈ Télécharger le workflow n8n (.json)

Ce à quoi t'attendre

  • Dix minutes pour le premier clone, échantillon compris
  • Le coût réel : quelques centimes par génération, contre 30 à 80 € une voix off freelance
  • Le vrai gain : tu produis dix versions d'un script sans réserver un studio ni te réenregistrer
◈ Modèle WaveSpeed qwen3-tts
← Retour aux ressources