API dubbingu AI do filmów w ponad 135 językach

Prześlij wideo, wybierz język docelowy i pobierz gotowy film z dubbingiem. Jedno zapytanie do API wykonuje transkrypcję, tłumaczenie, rozpoznawanie mówców, klonowanie głosu oraz syntezę mowy. Zachowuje oryginalny głos lektora i zwraca film z dubbingiem, oddzielne ścieżki audio WAV oraz pliki z napisami.
Klonowanie głosu
Wbudowana synchronizacja ruchu warg
REST + Python SDK
three requests, start to finish
OAuth 2.0
# 1. exchange client credentials for a token (valid 1 hour)
curl -X POST https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token \
  -u "$CLIENT_ID:$CLIENT_SECRET" \
  -d "grant_type=client_credentials"# 2. upload by link - YouTube, Drive, S3, Vimeo or direct URL
curl -X POST https://api.rask.ai/api/library/v1/media/link \
  -H "Authorization: Bearer $TOKEN" \
  -d '{"link": "https://youtu.be/...", "name": "Q3 launch"}'# 3. create the dubbing project - this starts the dub
curl -X POST https://api.rask.ai/v2/projects \
  -H "Authorization: Bearer $TOKEN" \
  -d '{
    "video_id": "b8f7835d-e8c9-4ff4-8e34-5c336d818319",
    "dst_lang": "es-mx",
    "name":     "Q3 launch"
  }'
GET /v2/projects/{project_id}
polling, 10s
# Poll the project until status is merging_done.while :; do
  curl -s https://api.rask.ai/v2/projects/$ID \
    -H "Authorization: Bearer $TOKEN" | jq .status
  sleep 10done
Używane przez zespoły na całym świecie
Możliwości

Wszystko, co potrafi API dubbingu, w jednym zapytaniu

Automatycznie generuj transkrypcję, tłumaczenie i dubbing wideo za pomocą jednego API. Dopracuj wyniki dzięki wyborowi głosów, słownikom i edycji tekstu. Dodaj opcjonalną synchronizację wargową, rozliczaną osobno.

Dubbing na ponad 135 języków

Cały proces w jednym zapytaniu: transkrypcja, tłumaczenie, synteza i miksowanie. Wystarczy przesłać wideo i wskazać język docelowy.

Wykrywanie mówców i osobne głosy dla każdego z nich

Mówcy są automatycznie oddzielani od oryginalnego dźwięku, a każdy z nich otrzymuje własny głos w języku docelowym. Możesz zmienić dowolne przypisanie lub podać liczbę osób, jeśli ją znasz.

Klonowanie głosu w różnych językach

Zachowaj oryginalną barwę głosu w dubbingu, dzięki czemu prezenter brzmi tak samo naturalnie po hiszpańsku, hindi, japońsku czy koreańskim.

Synchronizacja ruchu warg

Ruch ust dopasowany do zedubbingowanego dźwięku, jako dodatkowe zadanie w każdym projekcie. Wykrywanie twarzy działa w pierwszej kolejności, więc płacisz tylko wtedy, gdy funkcja ta zadziała.

Zachowane tło dźwiękowe

Muzyka, dźwięki otoczenia i efekty są oddzielane od mowy i miksowane na nowo pod ścieżką z dubbingiem. W efekcie otrzymujesz w pełni zlokalizowany film z oryginalnym tłem dźwiękowym i nowym głosem.

Napisy w formatach .srt i .vtt

Oba formaty są dołączane do każdego ukończonego projektu – zsynchronizowane z dubbingiem i gotowe do odtworzenia.

Kontrola terminologii za pomocą słowników

Nazwy marek, produktów i terminy techniczne są tłumaczone w ten sam sposób lub celowo pozostawiane bez zmian. Dzięki wersjonowaniu każdy ukończony projekt zachowuje słownik, z którego korzystał podczas dubbingowania.

Edycja skryptu na poziomie segmentów

Pobierz transkrypcję, popraw wers, dostosuj znacznik czasu, dodaj lub usuń fragment, a następnie wygeneruj całość ponownie. Twoi lingwiści poprawiają tekst bezpośrednio, a dubbing jest tworzony na nowo na podstawie ich zmian.

Skaluj bez ograniczeń

Prześlij cały katalog naraz i twórz dubbing w wielu językach równolegle, niezależnie od skali.
Zobacz jak to działa

Co tak naprawdę zwraca API dubbingu AI

Ten sam klip z dubbingiem wygenerowanym przez wywołanie API, o którym właśnie czytasz. Oryginalny głos w wersji źródłowej, sklonowany głos po francusku, niemiecku, portugalsku i hiszpańsku, z zachowanym dźwiękiem w tle.
Flaga EN
En
Flaga FR
Pt
Flaga Niemiec
De
Flaga PT
Pt
Flaga ES
Es
Przepływ pracy

Trzy kroki od pliku źródłowego do filmu z dubbingiem

Utworzenie projektu rozpoczyna dubbing. Użyj /generate później, aby zaktualizować dubbing po wprowadzeniu zmian.
1

Prześlij wideo

Wyślij plik jako formularz wieloczęściowy lub opublikuj link. Obsługiwane źródła linków to YouTube, Google Drive, S3, Vimeo oraz dowolny adres URL bezpośredniego pobierania. Zwraca identyfikator multimediów i pełne metadane techniczne, zanim cokolwiek wydasz.

POST /api/library/v1/media/link
2

Utwórz projekt

Przekaż identyfikator multimediów jako video_id oraz język docelowy. Opcjonalnie dołącz własną transkrypcję lub słowniczek. Dubbing rozpoczyna się natychmiast.

POST /v2/projects
3

Pobierz wynik

Sprawdzaj status, aż osiągnie wartość merging_done, a następnie pobierz zdubbingowane wideo, ścieżki dźwiękowe i pliki z napisami.

GET /v2/projects/{project_id}
Czas przetwarzania zależy od projektu. Śledź postępy za pomocą API i pobierz pliki po zakończeniu dubbingu.
Stworzone z myślą o Tobie

Nie ma tego na liście? Zbudujemy to.

Nowe języki, niestandardowe głosy, własna metoda dostarczania, większa przepustowość: gdy integracja dubbingu wymaga czegoś spoza standardowej oferty, nasz zespół opracuje to i przygotuje specjalnie dla Ciebie.

Języki i głosy

Potrzebujesz języka lub głosu spoza publicznego katalogu? Porozmawiaj z naszym zespołem o swoich wymaganiach i dostępnych opcjach.

Dostarczanie i integracja

Webhooki, przesyłanie do własnej kolejki, dostarczanie bezpośrednio do S3, niestandardowe endpointy. Powiedz nam, jak Twój system oczekuje danych.

Wolumen i przepustowość

Rozmiary partii, języki docelowe dla poszczególnych akcji oraz priorytet przetwarzania są ustalane w umowie tak, aby pasowały do Twojego procesu pracy.

Bezpieczeństwo i hosting

Kwestie związane z przechowywaniem danych, logowaniem SSO i SAML, zasadami ich zachowania oraz wsparciem przy audycie bezpieczeństwa są omawiane podczas wdrażania planu dla firm.
Przykłady zastosowań

Kto korzysta z API do dubbingu AI

Platformy zawierające materiały wideo

Platformy LMS i edukacyjne dla klientów, platformy twórców i wideo, narzędzia do webinarów i wydarzeń wirtualnych, hosting wideo i oprogramowanie workflow SaaS, cyfrowe platformy wsparcia użytkownika, zakupy na żywo. Treści edukacyjne, demonstracje produktów i materiały twórców są dubbingowane bezpośrednio w Twoim produkcie, dzięki czemu globalni odbiorcy słyszą je w swoim języku, a dubbing AI staje się jedną z funkcji Twojego rozwiązania.

Agencje lokalizacji i produkcyjne

Połącz dubbing AI z posiadanym już systemem dostarczania i zachowaj etap weryfikacji przez człowieka. Sztuczna inteligencja przygotowuje pierwszą wersję z dubbingiem, a Twoi lingwiści edytują tekst zamiast rezerwować studia nagraniowego.

Wewnętrzna, ciągła produkcja wideo

Międzynarodowy handel detaliczny i e-commerce, globalne franczyzy, wydawcy mediów, uniwersytety korporacyjne. Wbuduj lokalizację w swój proces publikacji, aby Twój zespół mógł generować nowe wersje językowe za każdym razem, gdy zmieni się wideo źródłowe.
Historie klientów

Prawdziwe zespoły, wymierne wyniki

Jak firmy lokalizują wideo z Rask, wyrażone w liczbach.
strzałka
strzałka
Kod

Przykłady kodu interfejsu API do dubbingu AI

Jeden pełny cykl dla każdego języka: uwierzytelnianie, przesyłanie, dubbing, oczekiwanie, pobieranie.
# pip install git+https://github.com/braskai/rask-sdk
import asyncio
from rask_sdk import RaskSDKClient

async def main():
    client = RaskSDKClient(client_id=CLIENT_ID, client_secret=CLIENT_SECRET)

    media   = await client.upload_media_link(link="https://youtu.be/...")
    project = await client.create_project(video_id=media.id, dst_lang="es-mx")

    while project.status != "merging_done":
        await asyncio.sleep(10)
        project = await client.get_project(project.id)

    print(project.translated_video, project.translation_srt_path)

asyncio.run(main())
github.com/braskai/rask-sdk
Python 3.8+, async
import os, time, requests

AUTH = "https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token"
API  = "https://api.rask.ai"

token = requests.post(AUTH, auth=(CLIENT_ID, CLIENT_SECRET),
                      data={"grant_type": "client_credentials"}).json()["access_token"]
h = {"Authorization": f"Bearer {token}"}

media = requests.post(f"{API}/api/library/v1/media/link", headers=h,
                      json={"link": "https://youtu.be/..."}).json()

project = requests.post(f"{API}/v2/projects", headers=h,
                        json={"video_id": media["id"], "dst_lang": "es-mx"}).json()

while project["status"] != "merging_done":
    time.sleep(10)
    project = requests.get(f"{API}/v2/projects/{project['id']}", headers=h).json()

print(project["translated_video"])
requests + polling
no SDK required
// no dependencies, Node 18+ global fetch
const API = 'https://api.rask.ai';

const auth = await fetch('https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token', {
  method: 'POST',
  headers: { Authorization: 'Basic ' + btoa(`${CLIENT_ID}:${CLIENT_SECRET}`) },
  body: new URLSearchParams({ grant_type: 'client_credentials' }),
}).then(r => r.json());

const h = { Authorization: `Bearer ${auth.access_token}`, 'Content-Type': 'application/json' };

const media = await fetch(`${API}/api/library/v1/media/link`, {
  method: 'POST', headers: h,
  body: JSON.stringify({ link: 'https://youtu.be/...' }),
}).then(r => r.json());

let project = await fetch(`${API}/v2/projects`, {
  method: 'POST', headers: h,
  body: JSON.stringify({ video_id: media.id, dst_lang: 'es-mx' }),
}).then(r => r.json());

while (project.status !== 'merging_done') {
  await new Promise(r => setTimeout(r, 10000));
  project = await fetch(`${API}/v2/projects/${project.id}`, { headers: h }).then(r => r.json());
}

console.log(project.translated_video);
fetch, Node 18+
plain HTTP
# 1. token (valid 1 hour - cache and reuse it)
TOKEN=$(curl -s -X POST https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token \
  -u "$CLIENT_ID:$CLIENT_SECRET" \
  -d "grant_type=client_credentials" | jq -r .access_token)

# 2. upload by link
VIDEO_ID=$(curl -s -X POST https://api.rask.ai/api/library/v1/media/link \
  -H "Authorization: Bearer $TOKEN" \
  -d '{"link": "https://youtu.be/..."}' | jq -r .id)

# 3. create the dubbing project
ID=$(curl -s -X POST https://api.rask.ai/v2/projects \
  -H "Authorization: Bearer $TOKEN" \
  -d "{\"video_id\": \"$VIDEO_ID\", \"dst_lang\": \"es-mx\"}" | jq -r .id)

# 4. poll, then download
while [ "$(curl -s https://api.rask.ai/v2/projects/$ID -H "Authorization: Bearer $TOKEN" | jq -r .status)" != "merging_done" ]; do
  sleep 10
done
POST /v2/projects
OAuth 2.0 client credentials
<?php
use GuzzleHttp\Client;

$http = new Client(['base_uri' => 'https://api.rask.ai']);

$auth = json_decode((new Client)->post(
    'https://rask-prod.auth.us-east-2.amazoncognito.com/oauth2/token',
    ['auth' => [$clientId, $clientSecret],
     'form_params' => ['grant_type' => 'client_credentials']]
)->getBody(), true);

$h = ['Authorization' => 'Bearer ' . $auth['access_token']];

$media = json_decode($http->post('/api/library/v1/media/link',
    ['headers' => $h, 'json' => ['link' => 'https://youtu.be/...']])->getBody(), true);

$project = json_decode($http->post('/v2/projects',
    ['headers' => $h, 'json' => ['video_id' => $media['id'], 'dst_lang' => 'es-mx']])->getBody(), true);

while ($project['status'] !== 'merging_done') {
    sleep(10);
    $project = json_decode($http->get("/v2/projects/{$project['id']}",
        ['headers' => $h])->getBody(), true);
}
Guzzle 7
plain HTTP
Python to oficjalny pakiet SDK. Zakładki Node, PHP i cURL przedstawiają proste przykłady żądań HTTP dla tych samych punktów końcowych.
Postęp

Jak projekt dubbingowy raportuje postępy

Projekt przechodzi przez udokumentowane stany, dzięki czemu możesz pokazać swoim użytkownikom prawdziwy, etapowy pasek postępu. Musisz zareagować tylko w trzech przypadkach.

Sukces, zatrzymaj się tutaj

merging_done
Dubbing został zakończony. Pobierz projekt ponownie, aby uzyskać linki do pobrania przygotowane dla Twojego projektu.

W toku, sprawdzaj dalej

created
uploading
transcription_started
separate_background_started
determine_speakers_started
translation_started
voiceover_started
merging_started
Oraz pasujące _done statusy. Doskonale pasują one do interfejsu pokazującego postęp krok po kroku.

Błąd, zatrzymanie i raport

failed
upload_failed
transcription_failed
translation_failed
voiceover_failed
merging_failed
no_audio
no_words
forbidden_link
no_audio, no_words oraz forbidden_link są wystarczająco jasne, aby pokazać je bezpośrednio Twoim użytkownikom.
Typical run, 4 minute source video
GET /v2/projects/{project_id}
   0s  created
  12s  transcription_started
  70s  translation_started
  95s  voiceover_started
 150s  merging_started
 170s  merging_done

Lub całkowicie pomiń sprawdzanie

Wskaż nam punkt końcowy webhooka, a każda zmiana stanu pojawi się jako żądanie POST, dzięki czemu Twoja kolejka zareaguje na każdą zmianę w momencie jej wystąpienia. Dostarczanie przez webhook jest częścią wdrożenia dla klientów korporacyjnych.
Przeczytaj dokumentację
preserveAspectRatio="xMidYMid meet" aria-hidden="true" role="img">
Wynik

Wideo z dubbingiem, dźwięk i napisy

Pobierz swój zdubbingowany wideo i przetłumaczone napisy w formatach SRT i VTT. W wybranych planach możesz również pobrać sam przetłumaczony głos lub zmiksowany z oryginalnym dźwiękiem w tle.
Pole
Format
Co to jest
translated_video
MP4
Zdubbingowane wideo, gotowe do publikacji
voiceover
WAV
Tylko przetłumaczona mowa, bez tła, idealna do własnego miksu
translated_audio
WAV
Przetłumaczona mowa zmiksowana z oryginalnym dźwiękiem w tle
translation_srt_path
.srt
Napisy w języku docelowym
translation_vtt_path
.vtt
Te same napisy w formacie WebVTT, do odtwarzaczy webowych
original_video
MP4
Twój plik źródłowy w takim stanie, w jakim został zapisany, do wglądu
Kontrola

Edytuj tekst, a następnie zdubbuj ponownie tylko to, co się zmieniło

Automatyczne tłumaczenie załatwia sprawę w większości przypadków. Jeśli tak nie jest, możesz edytować transkrypcję fragment po fragmencie i wygenerować ją ponownie – opłata zostanie naliczona tylko za zmienione elementy.

Edycja na poziomie segmentów

Edycja na poziomie segmentów
Każdy projekt udostępnia swoją transkrypcję jako podzielone na segmenty elementy, więc poprawienie błędnej linii wymaga tylko jednego zapytania.
Pobierz transkrypcję i jej segmenty
Zmień tekst źródłowy, a my przetłumaczymy go ponownie
Edytuj przetłumaczony tekst bezpośrednio, aby zachować własne słownictwo
Dopasowuj znaczniki czasu, dodawaj segmenty i usuwaj je
Zmień głos przypisany do dowolnego mówcy

Słowniczki terminologii

Słowniczki terminologii
Dodaj słowniczek do projektu, a nazwy Twojej marki, produktów oraz terminy techniczne będą tłumaczone dokładnie tak samo za każdym razem lub celowo pozostaną bez zmian.

Jeden słowniczek obejmuje jedną parę językową i działa we wszystkich odmianach regionalnych tego języka docelowego, więc jeden hiszpański słowniczek obsłuży es-mx oraz es-es podobnie. Projekt rejestruje wersja_słownika, dzięki czemu późniejsze poprawki nigdy nie zmieniają ukończonej pracy w tle.
Dane wejściowe

Obsługiwane formaty plików

Siedem formatów wideo i cztery formaty audio oraz pobieranie plików bezpośrednio z adresu URL. W przypadku przesłania nieobsługiwanego pliku API odrzuci go na podstawie typu zawartości, zanim naliczane będą jakiekolwiek minuty.

Wideo

7 formatów
.mp4
.mov
.mkv
.avi
.webm
.m4v
.3gp

Audio

4 formaty
.mp3
.wav
.flac
.m4a

Metadane przed wydaniem środków

Punkt końcowy multimediów zwraca czas trwania, rozmiar pliku, kodek wideo, liczbę klatek na sekundę, rozdzielczość, kodek audio, częstotliwość próbkowania oraz układ kanałów. Sprawdź plik i oszacuj koszt z góry, ponieważ dubbing jest rozliczany za minuty.
Bezpieczeństwo i zgodność z przepisami

Zatwierdzone przez osoby, które muszą zadawać pytania

Firma posiada certyfikat SOC 2 Type II, działa zgodnie z RODO (GDPR) i publikuje status swoich systemów w Centrum Zaufania.

Certyfikaty

SOC 2 Type II
RODO
Członek CAI i C2PA

Szyfrowanie

TLS 1.2 w tranzycie
AES-256 w spoczynku
Klucze zarządzane SSE-S3
Rotacja kluczy co najmniej co 12 miesięcy

Twoje treści

Zamknięte środowisko AI
Nigdy nieużywane do trenowania ogólnych modeli
Pełny eksport, bez wiązania się z jedną platformą

Dostęp

SSO i SAML
Kontrola dostępu oparta na rolach
Poświadczenia klienta OAuth 2.0

Dla firm

Opcje lokalizacji danych
Niestandardowe umowy SLA
Dedykowany opiekun klienta

Prawa do głosu

Syntetyczne głosy z prawami do użytkowania
Klonowanie głosu oparte na zgodzie
Zasady bezpieczeństwa AI, człowiek w pętli
Porównanie

API Rask a budowanie własnego rozwiązania

Te same możliwości dubbingu, zestawione na dwa sposoby. Jedna kolumna to umowa, druga to plan działania.
Czego potrzebujesz
Rask API
Złożone z części
Transkrypcja, tłumaczenie, synteza, miksowanie
Jedno wywołanie
Trzech do czterech dostawców i kod łączący ich systemy
Wykrywanie mówców i osobne głosy dla każdego z nich
W zestawie
Dostawca diaryzacji oraz własna logika przypisywania głosów
Muzyka w tle i efekty zachowane
W zestawie
Krok oddzielania ścieżek, który musisz sam zbudować i dostroić
Klonowanie głosu w różnych językach
W zestawie
Odrębny dostawca i osobny proces uzyskiwania zgody
Synchronizacja ruchu warg
W zestawie
Piąty dostawca
Napisy w formatach .srt i .vtt
W zestawie
Generowane na podstawie własnych danych czasowych
Poprawianie jednej niedokładnej linijki
Przetłumacz ponownie ten fragment i zapłać tylko za niego
Uruchom proces ponownie i zapłać za plik
Spójność terminologii
Słowniki z wersjami
Wstępne i końcowe przetwarzanie pod Twoją kontrolą
Limity zapytań
Brak
Ograniczenia Twojego najsłabszego dostawcy
Język, którego nikt jeszcze nie obsługuje
Stworzymy go
Niedostępne
Najczęściej zadawane pytania

API dubbingu AI: najczęściej zadawane pytania

Nie możesz znaleźć tego, czego szukasz? Skontaktuj się z działem sprzedaży.

Jak mogę uzyskać dostęp do API i klucz API?

Jak się uwierzytelnić w API dubbingu AI?

Czy API działa synchronicznie, czy asynchronicznie?

Jakie są limity zapytań?

Na ile języków mogę przetłumaczyć wideo?

Jak działa klonowanie głosu za pomocą API?

Jak długo trwa dubbing AI?

Jakie formaty plików są obsługiwane?

Jak API radzi sobie z wideo, w którym wypowiada się kilka osób?

Czy mogę dostarczyć własny scenariusz lub transkrypcję?

Czy oprócz wideo z dubbingiem otrzymuję również napisy?

Czy dostępny jest zestaw SDK?

Ile kosztuje ponowny dubbing po edycji?

Rozpocznij dubbingowanie w jedno popołudnie

Wyślij swoje pierwsze zapytanie już dziś i skontaktuj się z nami, gdy potrzebujesz warunków dla dużych wolumenów lub języka, którego nikt inny nie ma.