LipsieSync®: Mehrsprachige Video-Synchronisation mit einem Synchronsprecher pro Zielsprache

LipsieSync® ist ein Dienst für mehrsprachige Video-Synchronisation. Für jede Zielsprache spricht ein Synchronsprecher alle Dialoge ein, bevor die Aufnahme per Speech-to-Speech verarbeitet wird. Timing, Emotionen, Atempausen und Intentionen stammen aus dieser menschlichen Aufnahme. Anschliessend verändert Lipsie die Stimmfarbe, um für jede Person oder Figur eine eigene Stimmidentität zu erzeugen. Speech-to-Speech verändert die Stimmfarbe, nicht die Sprechleistung des Synchronsprechers. Die Dialoge werden vor der Aufnahme an die Zielsprache angepasst. Lip-Sync wird nur bei den Einstellungen eingesetzt, bei denen die sichtbaren Mundbewegungen an die synchronisierte Fassung angepasst werden müssen.

Fordern Sie ein LipsieSync®-Pilotvideo an — Senden Sie einen repräsentativen Videoausschnitt, die Zielsprachen und die Anzahl der zu synchronisierenden Personen. Lipsie prüft anhand des Ausschnitts die Dialoganpassung, die menschlich eingesprochenen Dialoge, die Unterscheidung der Stimmen und den Lip-Sync in den betreffenden Einstellungen. Danach legt Lipsie den Produktionsumfang, die Lieferzeit und die Lieferdateien fest.

LipsieSync® im Beispiel: dieselbe Person in vier Sprachen

Dieses Beispiel zeigt dieselbe Person auf Französisch, Englisch, Italienisch und Deutsch. Für jede Zielsprache spricht ein Synchronsprecher die Dialoge ein; danach wird die Aufnahme per Speech-to-Speech verarbeitet. Die Dialoge werden an die jeweilige Zielsprache angepasst. Lip-Sync wird nur dort eingesetzt, wo die sichtbaren Mundbewegungen an die synchronisierte Fassung angepasst werden müssen.

  • von einem Synchronsprecher eingesprochene Dialoge in jeder Zielsprache

  • Stimmfarbe an die Stimme der Person im Ausgangsvideo angenähert

  • Dialogdauer und Sprechrhythmus an die jeweilige Sprache angepasst

  • Lip-Sync nur bei Mundbewegungen, die eine Anpassung erfordern

Ausgangssprache: Französisch · Sprachversionen: Französisch, Englisch, Italienisch und Deutsch

Produktion: Dialoganpassung, Aufnahme durch einen Synchronsprecher, Speech-to-Speech-Stimmtransformation und Lip-Sync nur bei Bedarf.

Vollständige Sprachversionen ansehen — 26 Minuten

Was ist LipsieSync®?

LipsieSync® ist ein Dienst für mehrsprachige Video-Synchronisation. Pro Zielsprache spricht ein Synchronsprecher alle Dialoge ein; erst danach wird die Aufnahme per Speech-to-Speech verarbeitet. Sprechweise, Timing, Emotionen, Intentionen, Atempausen und Intensität stammen aus der Aufnahme des Synchronsprechers. Speech-to-Speech verändert anschliessend die Stimmfarbe, um für jede Person oder Figur eine eigene Stimmidentität zu erzeugen. Die Speech-to-Speech-Verarbeitung erfolgt lokal bei Lipsie und nicht über einen cloudbasierten Dienst zur Stimmtransformation. Die Dialoge werden vor der Aufnahme an die Zielsprache angepasst. Lip-Sync wird nur bei den Einstellungen eingesetzt, bei denen die sichtbaren Mundbewegungen angepasst werden müssen. Die Produktion wird von Lipsie betreut.

LipsieSync® in Kürze

Ein Synchronsprecher pro Zielsprache

Ein Synchronsprecher spricht alle Dialoge einer Sprachversion ein. Sprechweise, Timing, Emotionen, Atempausen und Intentionen stammen aus dieser Aufnahme und nicht aus einer synthetischen Stimme, die aus Text erzeugt wird.

Speech-to-Speech verändert die Stimmfarbe nach der Aufnahme

Die Aufnahme des Synchronsprechers entsteht vor der Stimmtransformation. Speech-to-Speech kann die Stimmfarbe anschliessend an die Stimme der Person oder Figur im Ausgangsvideo annähern. Sprechweise, Timing und Emotionen der Aufnahme bleiben dabei erhalten.

Eine eigene Stimmidentität für jede Person oder Figur

Derselbe Synchronsprecher kann mehrere Personen oder Figuren in einer Zielsprache einsprechen. Lipsie verarbeitet die einzelnen Aufnahmen zu unterscheidbaren Stimmidentitäten. Dadurch ist nicht für jede Person im Video ein eigener Synchronsprecher erforderlich.

Dialoge werden vor der Aufnahme an die Zielsprache angepasst

Vor der Aufnahme werden Formulierung, Dialogdauer, Sprechrhythmus, Intention und Aussprache angepasst. Grundlage sind die Bedeutung des Ausgangsdialogs, der Bildinhalt und die Anforderungen an die Synchronisation.

Lip-Sync wird nur bei ausgewählten Einstellungen eingesetzt

Die sichtbaren Mundbewegungen werden dort angepasst, wo die synchronisierte Fassung eine zusätzliche Angleichung erfordert. Lip-Sync wird nicht auf das gesamte Video angewendet.

Stimmidentitäten können in mehreren Videos wiederverwendet werden

Eine für eine Person oder Figur definierte Stimmidentität kann in weiteren Videos, Episoden oder Modulen wiederverwendet werden. So kann dieselbe Person in wiederkehrenden Inhalten dieselbe Stimme behalten. Lipsie betreut Dialoganpassung, Aufnahme, Stimmtransformation und Synchronisation innerhalb des vereinbarten Projektumfangs.

Für welche Videos eignet sich LipsieSync®?

LipsieSync® eignet sich für Videos, in denen eine oder mehrere Personen sichtbar sprechen und in jeder Zielsprache unterscheidbare Stimmidentitäten benötigen. Pro Zielsprache spricht ein Synchronsprecher alle Dialoge ein. Speech-to-Speech verändert anschliessend die Stimmfarbe der einzelnen Aufnahmen, sodass verschiedene Personen oder Figuren unterschiedliche Stimmen erhalten. Bei Serien, Schulungen und anderen wiederkehrenden Formaten können dieselben Stimmidentitäten in weiteren Videos oder Modulen verwendet werden.

Unternehmensvideos

Statements von Führungskräften, Unternehmensinterviews, Imagefilme, Kundenstimmen und interne Kommunikation. Bei wiederkehrenden Formaten kann dieselbe Person in mehreren Videos dieselbe Stimmidentität behalten.

Interviews und Dokumentarformate

Interviews mit mehreren Personen, Dokumentarserien, Magazine und andere Sachformate. Jede Person kann eine eigene Stimmidentität erhalten, ohne dass für jede Person ein separater Synchronsprecher eingesetzt werden muss.

Schulungen und Fachinhalte

Masterclasses, Weiterbildung, E-Learning mit sichtbaren Vortragenden sowie technische oder medizinische Inhalte. Die Dialoge werden in jeder Zielsprache von einem Synchronsprecher eingesprochen; wiederkehrende Personen können in mehreren Modulen dieselbe Stimmidentität behalten.

YouTube-Videos und Creator-Inhalte

Video-Podcasts, Gespräche, Serienformate und YouTube-Videos mit mehreren Personen. Ein Synchronsprecher pro Zielsprache kann mehrere Personen einsprechen; deren Stimmidentitäten können über weitere Episoden hinweg beibehalten werden.

Video-Synchronisation für YouTube und Creator  ➤

Was ist der Unterschied zwischen Sub2Dub®, LipsieSync® und Studio Premium?

Sub2Dub® erzeugt die Synchronfassung aus Text mit synthetischen Stimmen. Bei LipsieSync® spricht ein Synchronsprecher pro Zielsprache alle Dialoge ein; Speech-to-Speech verändert danach die Stimmfarbe und erzeugt unterschiedliche Stimmidentitäten. Bei Studio Premium wird jede Rolle von einem eigenen Synchronsprecher unter künstlerischer Leitung eingesprochen.

Vergleich von Sub2Dub®, LipsieSync® und Studio Premium für die Video-Synchronisation
Kriterium Sub2Dub® LipsieSync® Studio Premium
Grundlage der Synchronstimme Synthetische Stimme, die aus Text erzeugt wird Eigene Aufnahme für jede Rolle
Sprechweise, Timing und Emotionen Keine Aufnahme eines Synchronsprechers Stammen vom Synchronsprecher der jeweiligen Rolle und werden künstlerisch geleitet
Stimmfarbe Wird durch die ausgewählte synthetische Stimme bestimmt Wird durch die Stimme des Synchronsprechers der jeweiligen Rolle bestimmt
Anzahl Synchronsprecher Kein Synchronsprecher für die Aufnahme erforderlich Ein Synchronsprecher pro Rolle und Zielsprache
Stimmidentitäten Jeder Person kann eine synthetische Stimme zugewiesen werden Jede Rolle verwendet die Stimme des dafür eingesetzten Synchronsprechers
Korrekturen und Neuaufnahmen Text oder Einstellungen der Sprachgenerierung können angepasst werden Eine Korrektur kann eine neue Aufnahme mit dem Synchronsprecher der betreffenden Rolle erfordern
Lip-Sync Je nach Projekt verfügbar Wird im Rahmen von Aufnahme und Regie berücksichtigt
Richtwert für die Lieferzeit 10-Minuten-Video / 1 Sprache 1 bis 2 Arbeitstage 7 bis 15 Arbeitstage
Preisrichtwert Ab 30 € exkl. MwSt. pro Minute und Sprache Ab 180 € exkl. MwSt. pro Minute und Sprache
Einsatzbereiche Informationsvideos, grosse Volumen und kurze Lieferzeiten Fiktion, Animation, Broadcast und Produktionen mit eigenem Casting

Preisrichtwerte pro Minute des Ausgangsvideos und pro Sprache, exkl. MwSt., bei üblicher Sprechdichte. Der endgültige Preis hängt unter anderem von der Sprachkombination, der Anzahl der Personen, der Dialoganpassung, den mit Lip-Sync bearbeiteten Einstellungen, den Nutzungsrechten und den benötigten Lieferdateien ab. Für kurze Projekte kann ein Mindestauftragswert gelten.

Wie läuft ein LipsieSync®-Projekt ab?

Ein LipsieSync®-Projekt umfasst sechs Schritte: Videoanalyse, Transkription und Identifikation der Sprecher, Anpassung der Dialoge an die Zielsprache, Aufnahme eines Synchronsprechers pro Zielsprache, lokale Speech-to-Speech-Stimmtransformation mit selektivem Lip-Sync sowie Kontrolle, gezielte Korrekturen und Lieferung.

Die sechs Schritte eines LipsieSync-Projekts Ein LipsieSync-Projekt umfasst Videoanalyse, Transkription und Sprecheridentifikation, Dialoganpassung, Aufnahme des Synchronsprechers, lokale Speech-to-Speech-Stimmtransformation mit selektivem Lip-Sync sowie Kontrolle, Korrekturen und Lieferung. SCHRITT 1 Videoanalyse Format, Personen und sichtbare Einstellungen Zielsprachen, Nutzung und Rechte SCHRITT 2 Transkription und Sprecher Dialoge geprüft, Sprecher identifiziert Begriffe, Aussprache und Timecodes SCHRITT 3 Dialoganpassung Dialoge an die Zielsprache angepasst Sinn, Dauer, Rhythmus und Intention angepasst SCHRITT 4 Aufnahme des Synchronsprechers Timing, Emotionen und Intentionen Atempausen, Nuancen, freigegebene Takes SCHRITT 5 Speech-to-Speech und Lip-Sync Speech-to-Speech lokal bei Lipsie verarbeitet Stimmfarbe angenähert, Lip-Sync selektiv SCHRITT 6 Kontrolle, Korrekturen, Lieferung Stimmen, Synchronisation, Mix, Korrekturen Stimmidentitäten und Lieferdateien geprüft SCHRITT 1 Videoanalyse Format, Personen und sichtbare Einstellungen Zielsprachen, Nutzung und Rechte SCHRITT 2 Transkription und Sprecher Dialoge geprüft, Sprecher identifiziert Begriffe, Aussprache und Timecodes SCHRITT 3 Dialoganpassung Dialoge an die Zielsprache angepasst Sinn, Dauer, Rhythmus und Intention angepasst SCHRITT 4 Aufnahme des Synchronsprechers Timing, Emotionen und Intentionen Atempausen, Nuancen, freigegebene Takes SCHRITT 5 Speech-to-Speech und Lip-Sync Speech-to-Speech lokal bei Lipsie verarbeitet Stimmfarbe angenähert, Lip-Sync selektiv SCHRITT 6 Kontrolle und Lieferung Stimmen, Synchronisation, Mix, Korrekturen Stimmidentitäten und Lieferdateien geprüft

Häufige Fragen zu LipsieSync®

LipsieSync® ist ein Dienst für mehrsprachige Video-Synchronisation. Ein Synchronsprecher spricht die Dialoge in der Zielsprache ein; danach verändert Speech-to-Speech die Stimmfarbe. Die folgenden Antworten erklären die Stimmverarbeitung, den Lip-Sync, die Anzahl der Synchronsprecher, Nutzungsrechte, Preise und Lieferzeiten.

LipsieSync® ist ein Dienst für mehrsprachige Video-Synchronisation, bei dem ein Synchronsprecher die Dialoge in der Zielsprache einspricht, bevor die Stimme per Speech-to-Speech verändert wird. Für jede Person oder Figur kann dabei eine eigene Stimmidentität erzeugt werden. LipsieSync® kann in mehr als 50 Sprachen produziert werden. Lip-Sync wird nur dort eingesetzt, wo die sichtbaren Mundbewegungen zusätzlich angepasst werden müssen.

Speech-to-Speech verändert die Stimmfarbe nach der Aufnahme. Timing, Emotionen, Atempausen und Intentionen stammen weiterhin aus der Aufnahme des Synchronsprechers. Die Stimmfarbe kann anschliessend an die Stimme der jeweiligen Person oder Figur im Ausgangsvideo angenähert werden.

Nein. Die Speech-to-Speech-Verarbeitung erfolgt lokal bei Lipsie und nicht über einen cloudbasierten Dienst zur Stimmtransformation. Die Stimmfarbe wird nach der Aufnahme des Synchronsprechers in der Produktionsumgebung von Lipsie verarbeitet.

LipsieSync® verwendet einen Synchronsprecher pro Zielsprache, unabhängig von der Anzahl der Personen im Video. Dieser Synchronsprecher spricht alle Dialoge ein. Speech-to-Speech erzeugt danach unterschiedliche Stimmidentitäten für die einzelnen Personen oder Figuren. Dadurch ist nicht für jede Rolle ein eigener Synchronsprecher erforderlich.

Ja. Eine für eine Person oder Figur definierte Stimmidentität kann in mehreren Videos, Episoden oder Modulen wiederverwendet werden. Wiederkehrende Personen können dadurch in verschiedenen Inhalten dieselbe Stimme behalten.

Ja. Eine Korrektur kann auf die betroffene Stelle beschränkt werden. Je nach Änderung kann Lipsie einen Dialog neu anpassen, eine einzelne Passage neu aufnehmen oder Stimmtransformation, Synchronisation oder Lip-Sync korrigieren. Die gesamte Sprachversion muss dafür nicht grundsätzlich neu produziert werden.

Nein. Lip-Sync wird nur bei den Einstellungen eingesetzt, in denen die sichtbaren Mundbewegungen zusätzlich an die synchronisierte Fassung angepasst werden müssen. Dabei berücksichtigt Lipsie unter anderem die Sichtbarkeit des Gesichts, den Kamerawinkel, die Länge der Replik und die bereits durch die Dialoganpassung erreichte Synchronisation.

Die geplanten Veränderungen an Stimme und Bild müssen durch die erforderlichen Rechte und Einwilligungen abgedeckt sein. Vereinbart werden können insbesondere die betroffenen Personen, Sprachen, Gebiete, Medien und die Nutzungsdauer. Der Auftraggeber muss über die erforderlichen Rechte an den bereitgestellten Inhalten verfügen. Die Bedingungen für die Synchronsprecher werden für die jeweilige Produktion festgelegt.

LipsieSync® kostet ab 70 € exkl. MwSt. pro Minute des Ausgangsvideos und pro Sprache. Der endgültige Preis hängt unter anderem von der Videolänge, der Sprechdichte, der Anzahl der Personen, der Zielsprache, der Dialoganpassung, dem Lip-Sync, den Nutzungsrechten und den benötigten Lieferdateien ab. Für kurze Projekte kann ein Mindestauftragswert gelten.

Für ein 10-minütiges Video in einer Zielsprache beträgt die Lieferzeit in der Regel 4 bis 7 Arbeitstage. Sie hängt von der Sprechdichte, der Anzahl der Personen, der Zielsprache, der Verfügbarkeit des Synchronsprechers, den Freigaben und der Anzahl der Einstellungen mit Lip-Sync ab.

Offerte für ein LipsieSync®-Synchronisationsprojekt anfordern

Geben Sie die Videolänge, die Zielsprachen, die Anzahl der zu synchronisierenden Personen und den geplanten Veröffentlichungstermin an. Lipsie nennt Ihnen den Produktionsumfang, den Preis und die voraussichtliche Lieferzeit für Ihr Projekt.

Ein Synchronsprecher pro Zielsprache · Speech-to-Speech lokal bei Lipsie verarbeitet · Lip-Sync nur bei ausgewählten Einstellungen