Synchronisation verfeinern und neu generieren

Bearbeiten Sie das Quelltranskript und die Übersetzungen und generieren Sie die Audiodatei einer Sprache neu.

Anleitung · Setzt voraus, dass Sie ein Synchronisationsprojekt erstellt und mindestens eine Sprache generiert haben, wie im Synchronisation-Schnellstart gezeigt.

Die in dieser Anleitung verwendeten Endpunkte zum Bearbeiten und Neugenerieren von Transkripten sind nur für Enterprise-Workspaces verfügbar. Kontaktieren Sie den Vertrieb, um Zugriff zu erhalten.

Eine Synchronisation ist nur so präzise wie das Transkript, auf dem sie basiert. Diese Anleitung zeigt die zwei Stellen, an denen Sie Korrekturen vornehmen können – das Quelltranskript und die Übersetzung einer Sprache – sowie, wie Sie das Audio neu generieren, sobald Sie zufrieden sind.

So funktionieren Überarbeitungen

Jedes Projekt und jede Sprache haben einen eigenen Zähler für revision, der jeweils bei 0 beginnt.

  • Das Bearbeiten des Quelltranskripts erhöht die revision des Projekts. Die Transkription selbst nicht.
  • Das Bearbeiten einer Übersetzung erhöht die revision dieser Sprache. Die Quelle oder andere Sprachen sind davon nicht betroffen.
  • Eine Sprache meldet außerdem output_revision: die Überarbeitung, aus der das aktuelle Audio generiert wurde. Wenn output_revision hinter revision liegt, ist das heruntergeladene Audio nicht aktuell und der Status der Sprache wird zu stale.

Korrigieren Sie das Quelltranskript nach Möglichkeit, bevor Sie Sprachen hinzufügen. Übersetzungen werden aus der Quelle erstellt. Wenn Sie die Quelle zuerst korrigieren, beginnt jede Sprache mit dem richtigen Text. Das Bearbeiten der Quelle, nachdem eine Sprache existiert, markiert diese Sprache als stale und erfordert eine Neugenerierung.

Quelltranskript bearbeiten

Lesen Sie das Quelltranskript, um die stabile id jedes Segments abzurufen. Anschließend können Sie Segmente bearbeiten, hinzufügen oder löschen.

import os
from dotenv import load_dotenv
from elevenlabs.client import ElevenLabs
load_dotenv()
elevenlabs = ElevenLabs(api_key=os.getenv("ELEVENLABS_API_KEY"))
# Replace with your project's ID
project_id = "proj_1601kwkyxp0hfzvtmyxwqxx6mcy3"
# Read the source transcript
transcript = elevenlabs.dubbing.project.transcript.get(project_id)
first_segment = transcript.segments[0]
# Correct a segment's text
elevenlabs.dubbing.project.transcript.update_segment(
project_id,
segment_id=first_segment.id,
text="Welcome to our latest product demo.",
)
# Add a segment (reuse an existing speaker_id so it is dubbed with that voice)
added = elevenlabs.dubbing.project.transcript.create_segment(
project_id,
text="Thanks for watching.",
speaker_id=first_segment.speaker_id,
start_s=40.0,
end_s=42.0,
)
# Delete the segment we just added
elevenlabs.dubbing.project.transcript.delete_segment(
project_id,
segment_id=added.segment.id,
)

Beim Bearbeiten der Zeitangaben muss end_s größer als start_s sein. Neue Segmente erfordern alle vier Felder (text, speaker_id, start_s, end_s); der Server weist die id des Segments zu.

Übersetzung verfeinern

Ein Sprachtranskript ordnet jedem Quellsegment seine Übersetzung zu. Die id-Werte der Segmente stimmen mit denen des Quelltranskripts überein. So können Sie Übersetzungen dem Originaltext gegenüberstellen. Bearbeiten Sie die Übersetzung eines einzelnen Segments, um die maschinelle Übersetzung zu überschreiben. Übergeben Sie null, um eine Übersetzung zu löschen und das Segment zur erneuten Übersetzung zu markieren.

project_id = "proj_1601kwkyxp0hfzvtmyxwqxx6mcy3"
language_id = "lang_1001kwkyxp0je6ktn4knsfrasx5s"
# Read the language's translations
target = elevenlabs.dubbing.project.language.transcript.get(project_id, language_id)
first_segment = target.segments[0]
# Refine a single translation
elevenlabs.dubbing.project.language.transcript.update_segment(
project_id,
language_id,
segment_id=first_segment.id,
translation="Bienvenido a nuestra última demostración de producto.",
)

Das Bearbeiten einer Übersetzung erhöht die revision der Sprache. Wenn die Sprache bereits abgeschlossen war, wird sie zu stale und behält ihr bisheriges Audio, bis Sie sie neu generieren.

Audio neu generieren

Nachdem Sie das Quelltranskript oder eine Übersetzung bearbeitet haben, generieren Sie die Sprache neu, um eine aktuelle Synchronisation aus dem aktuellen Transkript zu erstellen. Für die Neugenerierung fallen dieselben Kosten wie für eine Generierung an.

import time
# Regenerate from the current transcript
elevenlabs.dubbing.project.language.transcript.regenerate(project_id, language_id)
# Poll until the new output is ready
while True:
language = elevenlabs.dubbing.project.language.get(project_id, language_id)
if language.status == "completed":
break
if language.status == "failed":
raise RuntimeError("Regeneration failed")
time.sleep(5)
print("Fresh output at", language.outputs.lossless_audio)

Die Neugenerierung gibt 409 Conflict zurück, wenn das Projekt nicht ready ist oder sich die Sprache nicht in einem stabilen Zustand befindet, etwa wenn sie bereits generiert wird. Sobald die Sprache wieder completed erreicht, entspricht output_revision der revision und das heruntergeladene Audio enthält Ihre Änderungen.

Sie können beim Hinzufügen einer Sprache mit der Stimmeinstellung cloning_strength (0 bis 10, Standardwert 7) steuern, wie stark die synchronisierten Sprecher die Quellstimmen klonen. Siehe die API-Referenz für das Erstellen eines Sprachziels.