LipsieSync® ist ein Dienst für mehrsprachige Video-Synchronisation. Für jede Zielsprache spricht ein Synchronsprecher alle Dialoge ein, bevor die Aufnahme per Speech-to-Speech verarbeitet wird. Timing, Emotionen, Atempausen und Intentionen stammen aus dieser menschlichen Aufnahme. Anschliessend verändert Lipsie die Stimmfarbe, um für jede Person oder Figur eine eigene Stimmidentität zu erzeugen. Speech-to-Speech verändert die Stimmfarbe, nicht die Sprechleistung des Synchronsprechers. Die Dialoge werden vor der Aufnahme an die Zielsprache angepasst. Lip-Sync wird nur bei den Einstellungen eingesetzt, bei denen die sichtbaren Mundbewegungen an die synchronisierte Fassung angepasst werden müssen.
Dieses Beispiel zeigt dieselbe Person auf Französisch, Englisch, Italienisch und Deutsch. Für jede Zielsprache spricht ein Synchronsprecher die Dialoge ein; danach wird die Aufnahme per Speech-to-Speech verarbeitet. Die Dialoge werden an die jeweilige Zielsprache angepasst. Lip-Sync wird nur dort eingesetzt, wo die sichtbaren Mundbewegungen an die synchronisierte Fassung angepasst werden müssen.
Ausgangssprache: Französisch · Sprachversionen: Französisch, Englisch, Italienisch und Deutsch
Produktion: Dialoganpassung, Aufnahme durch einen Synchronsprecher, Speech-to-Speech-Stimmtransformation und Lip-Sync nur bei Bedarf.
LipsieSync® ist ein Dienst für mehrsprachige Video-Synchronisation. Pro Zielsprache spricht ein Synchronsprecher alle Dialoge ein; erst danach wird die Aufnahme per Speech-to-Speech verarbeitet. Sprechweise, Timing, Emotionen, Intentionen, Atempausen und Intensität stammen aus der Aufnahme des Synchronsprechers. Speech-to-Speech verändert anschliessend die Stimmfarbe, um für jede Person oder Figur eine eigene Stimmidentität zu erzeugen. Die Speech-to-Speech-Verarbeitung erfolgt lokal bei Lipsie und nicht über einen cloudbasierten Dienst zur Stimmtransformation. Die Dialoge werden vor der Aufnahme an die Zielsprache angepasst. Lip-Sync wird nur bei den Einstellungen eingesetzt, bei denen die sichtbaren Mundbewegungen angepasst werden müssen. Die Produktion wird von Lipsie betreut.
Ein Synchronsprecher spricht alle Dialoge einer Sprachversion ein. Sprechweise, Timing, Emotionen, Atempausen und Intentionen stammen aus dieser Aufnahme und nicht aus einer synthetischen Stimme, die aus Text erzeugt wird.
Die Aufnahme des Synchronsprechers entsteht vor der Stimmtransformation. Speech-to-Speech kann die Stimmfarbe anschliessend an die Stimme der Person oder Figur im Ausgangsvideo annähern. Sprechweise, Timing und Emotionen der Aufnahme bleiben dabei erhalten.
Derselbe Synchronsprecher kann mehrere Personen oder Figuren in einer Zielsprache einsprechen. Lipsie verarbeitet die einzelnen Aufnahmen zu unterscheidbaren Stimmidentitäten. Dadurch ist nicht für jede Person im Video ein eigener Synchronsprecher erforderlich.
Vor der Aufnahme werden Formulierung, Dialogdauer, Sprechrhythmus, Intention und Aussprache angepasst. Grundlage sind die Bedeutung des Ausgangsdialogs, der Bildinhalt und die Anforderungen an die Synchronisation.
Die sichtbaren Mundbewegungen werden dort angepasst, wo die synchronisierte Fassung eine zusätzliche Angleichung erfordert. Lip-Sync wird nicht auf das gesamte Video angewendet.
Eine für eine Person oder Figur definierte Stimmidentität kann in weiteren Videos, Episoden oder Modulen wiederverwendet werden. So kann dieselbe Person in wiederkehrenden Inhalten dieselbe Stimme behalten. Lipsie betreut Dialoganpassung, Aufnahme, Stimmtransformation und Synchronisation innerhalb des vereinbarten Projektumfangs.
LipsieSync® eignet sich für Videos, in denen eine oder mehrere Personen sichtbar sprechen und in jeder Zielsprache unterscheidbare Stimmidentitäten benötigen. Pro Zielsprache spricht ein Synchronsprecher alle Dialoge ein. Speech-to-Speech verändert anschliessend die Stimmfarbe der einzelnen Aufnahmen, sodass verschiedene Personen oder Figuren unterschiedliche Stimmen erhalten. Bei Serien, Schulungen und anderen wiederkehrenden Formaten können dieselben Stimmidentitäten in weiteren Videos oder Modulen verwendet werden.
Statements von Führungskräften, Unternehmensinterviews, Imagefilme, Kundenstimmen und interne Kommunikation. Bei wiederkehrenden Formaten kann dieselbe Person in mehreren Videos dieselbe Stimmidentität behalten.
Interviews mit mehreren Personen, Dokumentarserien, Magazine und andere Sachformate. Jede Person kann eine eigene Stimmidentität erhalten, ohne dass für jede Person ein separater Synchronsprecher eingesetzt werden muss.
Masterclasses, Weiterbildung, E-Learning mit sichtbaren Vortragenden sowie technische oder medizinische Inhalte. Die Dialoge werden in jeder Zielsprache von einem Synchronsprecher eingesprochen; wiederkehrende Personen können in mehreren Modulen dieselbe Stimmidentität behalten.
Video-Podcasts, Gespräche, Serienformate und YouTube-Videos mit mehreren Personen. Ein Synchronsprecher pro Zielsprache kann mehrere Personen einsprechen; deren Stimmidentitäten können über weitere Episoden hinweg beibehalten werden.
Video-Synchronisation für YouTube und Creator ➤
Sub2Dub® erzeugt die Synchronfassung aus Text mit synthetischen Stimmen. Bei LipsieSync® spricht ein Synchronsprecher pro Zielsprache alle Dialoge ein; Speech-to-Speech verändert danach die Stimmfarbe und erzeugt unterschiedliche Stimmidentitäten. Bei Studio Premium wird jede Rolle von einem eigenen Synchronsprecher unter künstlerischer Leitung eingesprochen.
| Kriterium | Sub2Dub® | LipsieSync® | Studio Premium |
|---|---|---|---|
| Grundlage der Synchronstimme | Synthetische Stimme, die aus Text erzeugt wird | Aufnahme eines Synchronsprechers in der Zielsprache | Eigene Aufnahme für jede Rolle |
| Sprechweise, Timing und Emotionen | Keine Aufnahme eines Synchronsprechers | Stammen aus der Aufnahme des Synchronsprechers | Stammen vom Synchronsprecher der jeweiligen Rolle und werden künstlerisch geleitet |
| Stimmfarbe | Wird durch die ausgewählte synthetische Stimme bestimmt | Speech-to-Speech verändert die Stimmfarbe nach der Aufnahme; Sprechweise, Timing und Emotionen bleiben aus der Aufnahme erhalten | Wird durch die Stimme des Synchronsprechers der jeweiligen Rolle bestimmt |
| Anzahl Synchronsprecher | Kein Synchronsprecher für die Aufnahme erforderlich | Ein Synchronsprecher pro Zielsprache, auch bei Videos mit mehreren Personen | Ein Synchronsprecher pro Rolle und Zielsprache |
| Stimmidentitäten | Jeder Person kann eine synthetische Stimme zugewiesen werden | Für jede Person oder Figur kann aus der Aufnahme des Synchronsprechers eine eigene Stimmidentität erzeugt werden | Jede Rolle verwendet die Stimme des dafür eingesetzten Synchronsprechers |
| Korrekturen und Neuaufnahmen | Text oder Einstellungen der Sprachgenerierung können angepasst werden | Je nach gewünschter Änderung können Dialoganpassung, einzelne Aufnahmen oder Stimmtransformation gezielt korrigiert werden | Eine Korrektur kann eine neue Aufnahme mit dem Synchronsprecher der betreffenden Rolle erfordern |
| Lip-Sync | Je nach Projekt verfügbar | Wird nur dort eingesetzt, wo die sichtbaren Mundbewegungen an die synchronisierte Fassung angepasst werden müssen | Wird im Rahmen von Aufnahme und Regie berücksichtigt |
| Richtwert für die Lieferzeit 10-Minuten-Video / 1 Sprache | 1 bis 2 Arbeitstage | 4 bis 7 Arbeitstage | 7 bis 15 Arbeitstage |
| Preisrichtwert | Ab 30 € exkl. MwSt. pro Minute und Sprache | Ab 70 € exkl. MwSt. pro Minute und Sprache | Ab 180 € exkl. MwSt. pro Minute und Sprache |
| Einsatzbereiche | Informationsvideos, grosse Volumen und kurze Lieferzeiten | Videos mit sichtbaren Personen, Interviews, Schulungen und Inhalte mit mehreren Personen | Fiktion, Animation, Broadcast und Produktionen mit eigenem Casting |
Preisrichtwerte pro Minute des Ausgangsvideos und pro Sprache, exkl. MwSt., bei üblicher Sprechdichte. Der endgültige Preis hängt unter anderem von der Sprachkombination, der Anzahl der Personen, der Dialoganpassung, den mit Lip-Sync bearbeiteten Einstellungen, den Nutzungsrechten und den benötigten Lieferdateien ab. Für kurze Projekte kann ein Mindestauftragswert gelten.
Ein LipsieSync®-Projekt umfasst sechs Schritte: Videoanalyse, Transkription und Identifikation der Sprecher, Anpassung der Dialoge an die Zielsprache, Aufnahme eines Synchronsprechers pro Zielsprache, lokale Speech-to-Speech-Stimmtransformation mit selektivem Lip-Sync sowie Kontrolle, gezielte Korrekturen und Lieferung.
LipsieSync® ist ein Dienst für mehrsprachige Video-Synchronisation. Ein Synchronsprecher spricht die Dialoge in der Zielsprache ein; danach verändert Speech-to-Speech die Stimmfarbe. Die folgenden Antworten erklären die Stimmverarbeitung, den Lip-Sync, die Anzahl der Synchronsprecher, Nutzungsrechte, Preise und Lieferzeiten.
Geben Sie die Videolänge, die Zielsprachen, die Anzahl der zu synchronisierenden Personen und den geplanten Veröffentlichungstermin an. Lipsie nennt Ihnen den Produktionsumfang, den Preis und die voraussichtliche Lieferzeit für Ihr Projekt.
Ein Synchronsprecher pro Zielsprache · Speech-to-Speech lokal bei Lipsie verarbeitet · Lip-Sync nur bei ausgewählten Einstellungen