API de doublage par IA pour vidéos en plus de 135 langues

Téléchargez votre vidéo, choisissez une langue cible et récupérez la vidéo doublée. Une seule requête d'API de doublage par IA gère la transcription, la traduction, la détection des locuteurs, la clonage de voix et la synthèse vocale, préserve l'identité vocale du locuteur d'origine, et renvoie une vidéo doublée, des pistes audio WAV séparées et des fichiers de sous-titres.
Clonage vocal
Synchronisation labiale intégrée
REST + Kit de développement Python (SDK)
three requests, start to finish
OAuth 2.0
# 1. exchange client credentials for a token (valid 1 hour)
curl -X POST https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token \
  -u "$CLIENT_ID:$CLIENT_SECRET" \
  -d "grant_type=client_credentials"# 2. upload by link - YouTube, Drive, S3, Vimeo or direct URL
curl -X POST https://api.rask.ai/api/library/v1/media/link \
  -H "Authorization: Bearer $TOKEN" \
  -d '{"link": "https://youtu.be/...", "name": "Q3 launch"}'# 3. create the dubbing project - this starts the dub
curl -X POST https://api.rask.ai/v2/projects \
  -H "Authorization: Bearer $TOKEN" \
  -d '{
    "video_id": "b8f7835d-e8c9-4ff4-8e34-5c336d818319",
    "dst_lang": "es-mx",
    "name":     "Q3 launch"
  }'
GET /v2/projects/{project_id}
polling, 10s
# Poll the project until status is merging_done.while :; do
  curl -s https://api.rask.ai/v2/projects/$ID \
    -H "Authorization: Bearer $TOKEN" | jq .status
  sleep 10done
Utilisé par des équipes du monde entier
Fonctionnalités

Tout ce que l'API de doublage peut faire, en un seul appel

Transcrivez, traduisez et doublez automatiquement vos vidéos via une seule API. Affinez les résultats grâce au choix des voix, aux glossaires et à l'édition de scripts. Ajoutez la synchronisation labial en option, facturée séparément.

Doublage dans plus de 135 langues

Tout le processus en une seule requête : transcrire, traduire, synthétiser, mixer. Vous n'avez qu'à envoyer une vidéo et une langue cible.

Détection des locuteurs et voix par locuteur

Les locuteurs sont automatiquement séparés de l'audio d'origine et chacun obtient sa propre voix dans la langue cible. Modifiez n'importe quelle attribution ou indiquez le nombre si vous le connaissez.

Clonage de voix multilingue

Conservez l'identité vocale du locuteur d'origine dans le doublage, afin que le présentateur garde sa voix en espagnol, en hindi, en japonais ou en coréen.

Synchronisation labiale

Mouvements des lèvres synchronisés avec l'audio doublé, en tant que tâche distincte sur n'importe quel projet doublé. La détection des visages s'exécute en premier pour que vous ne payiez que là où cela fonctionne.

Audio d'arrière-plan préservé

La musique, l'ambiance et les effets sonores sont séparés de la voix et mixés à nouveau sous le doublage. Le résultat est une piste entièrement localisée avec la musique, l'ambiance et les effets d'origine sous la nouvelle voix.

Sous-titres au format .srt et .vtt

Les deux formats sont fournis avec chaque projet terminé, synchronisés avec le doublage et prêts pour votre lecteur.

Gestion de la terminologie grâce aux glossaires

Les noms de marques, de produits et les termes techniques sont traduits de la même manière à chaque fois, ou restent non traduits intentionnellement. Versionné, pour que chaque projet terminé conserve le glossaire avec lequel il a été doublé.

Modification du script par segment

Récupérez la transcription, corrigez une ligne, ajustez un horodatage, ajoutez ou supprimez un segment, puis régénérez. Vos linguistes corrigent directement le script, et le doublage se régénère à partir de leurs modifications.

Évoluez sans limites

Envoyez votre catalogue complet en une seule fois et doublez dans toutes les langues cibles en parallèle, quel que soit le volume.
Voir en action

Ce que l'API de doublage par IA renvoie réellement

Le même clip, doublé par le même appel API que vous venez de lire. Voix d'origine sur la source, voix clonée en français, allemand, portugais et espagnol, audio de fond intact.
Drapeau EN
En
Drapeau FR
Fr
Drapeau DE
De
Drapeau du Portugal
Pt
Drapeau ES
Es
Flux de travail

Trois étapes entre le fichier source et la vidéo doublée

La création du projet lance le doublage. Utilisez /generate plus tard pour redoubler un projet après l'avoir modifié.
1

Téléchargez votre vidéo

Envoyez un fichier sous forme de données de formulaire multipart, ou publiez un lien. Les sources de liens prises en charge sont YouTube, Google Drive, S3, Vimeo et toute URL de téléchargement direct. Renvoie un ID de média et des métadonnées techniques complètes avant toute dépense.

POST /api/library/v1/media/link
2

Créer le projet

Transmettez l'ID du média en tant que video_id et une langue cible. Vous pouvez également joindre votre propre transcription ou un glossaire. Le doublage commence immédiatement.

POST /v2/projects
3

Récupérer le résultat

Lisez status jusqu'à ce qu'il atteigne merging_done, puis téléchargez la vidéo doublée, les pistes audio et les fichiers de sous-titres.

GET /v2/projects/{project_id}
Le temps de traitement varie selon le projet. Suivez la progression via l'API et téléchargez vos fichiers une fois le doublage terminé.
Conçu pour vous

Pas sur la liste ? Nous le créons.

Nouvelles langues, voix personnalisées, votre propre méthode de diffusion, débit plus élevé : lorsqu'une intégration de doublage nécessite quelque chose hors du catalogue public, notre équipe l'étudie avec vous et la crée.

Langues et voix

Besoin d'une langue ou d'une voix absente du catalogue public ? Parlez de vos besoins et des options disponibles à notre équipe.

Diffusion et intégration

Webhooks, envoi vers votre propre file d'attente, livraison directe sur votre S3, endpoints personnalisés. Dites-nous comment votre système souhaite être alimenté.

Volume et débit

Les tailles de lots, les langues cibles par action et la priorité de traitement sont définies dans votre contrat pour s'adapter à votre processus.

Sécurité et hébergement

La résidence des données, le SSO et SAML, les règles de conservation et le support pour l'examen de la sécurité sont pris en charge lors de l'intégration des grandes entreprises.
Cas d'utilisation

Qui utilise une API de doublage par IA

Plateformes intégrant de la vidéo

Plateformes LMS et de formation client, plateformes de créateurs et de vidéo, outils de webinaires et d'événements virtuels, SaaS d'hébergement vidéo et de flux de travail, plateformes d'adoption numérique, live shopping. Le contenu éducatif, les démos de produits et les vidéos de créateurs sont doublés directement dans votre produit, permettant à un public mondial de les écouter dans sa propre langue et faisant du doublage par IA l'une de vos fonctionnalités.

Agences de localisation et de production

Connectez le doublage par IA au flux de diffusion que vous utilisez déjà et conservez l'étape de révision humaine. L'IA produit une première version doublée, et vos linguistes modifient le script au lieu de réserver un studio pour tout réenregistrer.

Production vidéo continue en interne

Vente au détail et e-commerce internationaux, franchises mondiales, éditeurs de médias, universités d'entreprise. Intégrez la localisation à votre flux de publication, afin que votre équipe puisse régénérer des versions linguistiques dès que la vidéo source change.
Témoignages clients

De véritables équipes, des résultats mesurables

Découvrez comment les entreprises localisent leurs vidéos avec Rask, chiffres à l'appui.
flèche
flèche
Code

Exemples de code pour l'API de doublage par IA

Un cycle complet dans chaque langue : authentification, téléchargement, doublage, attente, récupération.
# pip install git+https://github.com/braskai/rask-sdk
import asyncio
from rask_sdk import RaskSDKClient

async def main():
    client = RaskSDKClient(client_id=CLIENT_ID, client_secret=CLIENT_SECRET)

    media   = await client.upload_media_link(link="https://youtu.be/...")
    project = await client.create_project(video_id=media.id, dst_lang="es-mx")

    while project.status != "merging_done":
        await asyncio.sleep(10)
        project = await client.get_project(project.id)

    print(project.translated_video, project.translation_srt_path)

asyncio.run(main())
github.com/braskai/rask-sdk
Python 3.8+, async
import os, time, requests

AUTH = "https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token"
API  = "https://api.rask.ai"

token = requests.post(AUTH, auth=(CLIENT_ID, CLIENT_SECRET),
                      data={"grant_type": "client_credentials"}).json()["access_token"]
h = {"Authorization": f"Bearer {token}"}

media = requests.post(f"{API}/api/library/v1/media/link", headers=h,
                      json={"link": "https://youtu.be/..."}).json()

project = requests.post(f"{API}/v2/projects", headers=h,
                        json={"video_id": media["id"], "dst_lang": "es-mx"}).json()

while project["status"] != "merging_done":
    time.sleep(10)
    project = requests.get(f"{API}/v2/projects/{project['id']}", headers=h).json()

print(project["translated_video"])
requests + polling
no SDK required
// no dependencies, Node 18+ global fetch
const API = 'https://api.rask.ai';

const auth = await fetch('https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token', {
  method: 'POST',
  headers: { Authorization: 'Basic ' + btoa(`${CLIENT_ID}:${CLIENT_SECRET}`) },
  body: new URLSearchParams({ grant_type: 'client_credentials' }),
}).then(r => r.json());

const h = { Authorization: `Bearer ${auth.access_token}`, 'Content-Type': 'application/json' };

const media = await fetch(`${API}/api/library/v1/media/link`, {
  method: 'POST', headers: h,
  body: JSON.stringify({ link: 'https://youtu.be/...' }),
}).then(r => r.json());

let project = await fetch(`${API}/v2/projects`, {
  method: 'POST', headers: h,
  body: JSON.stringify({ video_id: media.id, dst_lang: 'es-mx' }),
}).then(r => r.json());

while (project.status !== 'merging_done') {
  await new Promise(r => setTimeout(r, 10000));
  project = await fetch(`${API}/v2/projects/${project.id}`, { headers: h }).then(r => r.json());
}

console.log(project.translated_video);
fetch, Node 18+
plain HTTP
# 1. token (valid 1 hour - cache and reuse it)
TOKEN=$(curl -s -X POST https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token \
  -u "$CLIENT_ID:$CLIENT_SECRET" \
  -d "grant_type=client_credentials" | jq -r .access_token)

# 2. upload by link
VIDEO_ID=$(curl -s -X POST https://api.rask.ai/api/library/v1/media/link \
  -H "Authorization: Bearer $TOKEN" \
  -d '{"link": "https://youtu.be/..."}' | jq -r .id)

# 3. create the dubbing project
ID=$(curl -s -X POST https://api.rask.ai/v2/projects \
  -H "Authorization: Bearer $TOKEN" \
  -d "{\"video_id\": \"$VIDEO_ID\", \"dst_lang\": \"es-mx\"}" | jq -r .id)

# 4. poll, then download
while [ "$(curl -s https://api.rask.ai/v2/projects/$ID -H "Authorization: Bearer $TOKEN" | jq -r .status)" != "merging_done" ]; do
  sleep 10
done
POST /v2/projects
OAuth 2.0 client credentials
<?php
use GuzzleHttp\Client;

$http = new Client(['base_uri' => 'https://api.rask.ai']);

$auth = json_decode((new Client)->post(
    'https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token',
    ['auth' => [$clientId, $clientSecret],
     'form_params' => ['grant_type' => 'client_credentials']]
)->getBody(), true);

$h = ['Authorization' => 'Bearer ' . $auth['access_token']];

$media = json_decode($http->post('/api/library/v1/media/link',
    ['headers' => $h, 'json' => ['link' => 'https://youtu.be/...']])->getBody(), true);

$project = json_decode($http->post('/v2/projects',
    ['headers' => $h, 'json' => ['video_id' => $media['id'], 'dst_lang' => 'es-mx']])->getBody(), true);

while ($project['status'] !== 'merging_done') {
    sleep(10);
    $project = json_decode($http->get("/v2/projects/{$project['id']}",
        ['headers' => $h])->getBody(), true);
}
Guzzle 7
plain HTTP
Python est le kit de développement officiel. Les onglets Node, PHP et cURL montrent des exemples HTTP simples utilisant les mêmes points de terminaison.
Progression

Comment un projet de doublage indique sa progression

Un projet passe par une machine à états documentée, ce qui vous permet d'afficher une véritable barre de progression par étapes pour vos propres utilisateurs. Vous n'avez besoin d'intervenir que sur trois groupes.

Succès, arrêtez-vous ici

merging_done
Le doublage est terminé. Récupérez le projet une fois de plus pour obtenir les liens de téléchargement disponibles pour votre projet.

En cours, continuez à vérifier

created
uploading
transcription_started
separate_background_started
determine_speakers_started
translation_started
voiceover_started
merging_started
Ainsi que la correspondance _done états. Ceux-ci correspondent parfaitement à une interface de progression par étapes.

Échec, arrêt et rapport

failed
upload_failed
transcription_failed
translation_failed
voiceover_failed
merging_failed
no_audio
no_words
forbidden_link
no_audio, no_words et forbidden_link sont assez précis pour être montrés directement à vos propres utilisateurs.
Typical run, 4 minute source video
GET /v2/projects/{project_id}
   0s  created
  12s  transcription_started
  70s  translation_started
  95s  voiceover_started
 150s  merging_started
 170s  merging_done

Ou ignorez complètement le sondage

Indiquez-nous un point de terminaison webhook et chaque changement d'état est envoyé sous forme de POST, permettant à votre file d'attente de réagir instantanément à chaque modification. L'envoi de webhooks fait partie de l'intégration pour les entreprises.
Lire la documentation
preserveAspectRatio="xMidYMid meet" aria-hidden="true" role="img">
Sortie

Vidéo doublée, audio et sous-titres

Téléchargez votre vidéo doublée ainsi que les sous-titres traduits aux formats SRT et VTT. Selon les abonnements éligibles, vous pouvez aussi télécharger la voix traduite seule ou mélangée à l'audio d'arrière-plan d'origine.
Champ
Format
Ce que c'est
translated_video
MP4
La vidéo doublée, prête à être publiée
voiceover
WAV
Discours traduit uniquement, sans arrière-plan, à intégrer dans votre propre mixage
translated_audio
WAV
Discours traduit mixé avec l'audio d'arrière-plan d'origine
translation_srt_path
.srt
Sous-titres dans la langue cible
translation_vtt_path
.vtt
Mêmes sous-titres au format WebVTT, pour les lecteurs web
original_video
MP4
Votre fichier source tel qu'il a été stocké, à titre de référence
Contrôle

Modifiez le script, puis redoublez uniquement ce qui a changé

La traduction automatique fait l'essentiel du travail. Si ce n'est pas le cas, vous pouvez modifier la transcription segment par segment et la régénérer, et vous ne payez que pour les parties que vous avez modifiées.

Édition au niveau des segments

Édition au niveau des segments
Chaque projet expose sa transcription sous forme de segments accessibles, ce qui permet de corriger une mauvaise ligne en une seule requête patch.
Récupérer la transcription et ses segments
Modifier le texte source pour lancer une nouvelle traduction
Modifier directement le texte traduit pour conserver vos propres formulations
Ajuster les repères temporels, ajouter ou supprimer des segments
Réassigner la voix associée à un locuteur

Glossaires pour la terminologie

Glossaires pour la terminologie
Associez un glossaire à un projet pour que vos noms de marque, noms de produits et termes techniques soient traduits de la même manière à chaque fois, ou conservés tels quels si vous le souhaitez.

Un glossaire couvre une paire de langues et s'applique à toutes les variantes régionales de cette langue cible. Ainsi, un seul glossaire en espagnol sert es-mx et es-es de la même manière. L'historique du projet glossary_version, de sorte que les modifications ultérieures ne modifient jamais discrètement le travail déjà terminé.
Entrée

Formats de fichiers pris en charge

Sept formats vidéo et quatre formats audio, avec en plus la possibilité d'importer directement depuis une URL. Si vous envoyez un fichier non pris en charge, l'API le rejette en fonction du type de contenu avant qu'aucune minute ne soit décomptée.

Vidéo

7 formats
.mp4
.mov
.mkv
.avi
.webm
.m4v
.3gp

Audio

4 formats
.mp3
.wav
.flac
.m4a

Métadonnées avant de dépenser

L'endpoint média renvoie la durée, la taille du fichier, le codec vidéo, la fréquence d'images, la résolution, le codec audio, la fréquence d'échantillonnage et la configuration des canaux. Validez un fichier et estimez le coût à l'avance, car le doublage est facturé à la minute.
Sécurité et conformité

Approuvé par les services de conformité

Brask Inc détient la certification SOC 2 Type II, respecte le RGPD et publie l'état de ses contrôles en direct dans son Centre de confiance.

Certifications

SOC 2 Type II
GDPR
Membre CAI et C2PA

Cryptage

TLS 1.2 en transit
AES-256 au repos
Clés gérées SSE-S3
Rotation des clés au moins tous les 12 mois

Votre contenu

Environnement d'IA fermé
Jamais utilisé pour entraîner des modèles généraux
Exportation complète, sans dépendance vis-à-vis d'un fournisseur

Accès

SSO et SAML
Contrôle d'accès basé sur les rôles
Identifiants client OAuth 2.0

Entreprise

Options de résidence des données
SLA personnalisés
Gestionnaire de compte dédié

Droits sur les voix

Voix synthétiques avec droits d'utilisation
Clonage de voix basé sur le consentement
Contrôles de sécurité de l'IA, intervention humaine
Comparaison

Rask API par rapport à une solution interne

La même capacité de doublage, assemblée de deux manières. Une colonne est un contrat ; l'autre est une feuille de route.
Ce dont vous avez besoin
Rask API
Assemblé à partir de pièces
Transcription, traduction, synthèse, mixage
Un seul appel
Trois à quatre fournisseurs et la logique pour les relier
Détection des locuteurs et voix par locuteur
Inclus
Un fournisseur de diarisation ainsi que votre propre logique d'attribution des voix
Musique de fond et effets préservés
Inclus
Une étape de séparation des sources que vous créez et ajustez
Clonage de voix multilingue
Inclus
Un fournisseur distinct et un flux de consentement distinct
Synchronisation labiale
Inclus
Un cinquième fournisseur
Sous-titres au format .srt et .vtt
Inclus
Généré à partir de vos propres données de minutage
Correction d'une mauvaise ligne
Redoubler ce segment, facturé pour ce segment
Relancer le processus, payer pour le fichier
Cohérence de la terminologie
Glossaires versionnés
Prétraitement et post-traitement gérés par vos soins
Limites de taux
Aucun
Ce qu'impose votre fournisseur le moins performant
Une langue qu'aucun autre ne prend encore en charge
Nous la créons
Non disponible
FAQ

API de doublage par IA : questions fréquentes

Vous ne trouvez pas ce que vous cherchez ? Contactez le service commercial.

Comment obtenir un accès à l'API et une clé API ?

Comment s'authentifier auprès de l'API de doublage par IA ?

L'API est-elle synchrone ou asynchrone ?

Quelles sont les limites de taux ?

Dans combien de langues puis-je doubler une vidéo ?

Comment fonctionne le clonage de voix avec l'API ?

Combien de temps dure le doublage par IA ?

Quels formats de fichiers sont pris en charge ?

Comment l'API gère-t-elle une vidéo comportant plusieurs intervenants ?

Puis-je fournir mon propre script ou transcription ?

Est-ce que j'obtiens des sous-titres en plus d'une vidéo doublée ?

Existe-t-il un SDK ?

Combien coûte un nouveau doublage après une modification ?

Commencez à doubler en un après-midi

Faites votre première demande dès aujourd'hui et contactez-nous si vous avez besoin de tarifs de gros ou d'une langue introuvable ailleurs.