Text-to-Speech in CapCut PC: So verwandelst du Text in Sprache (Tutorial)

Melden

Hier ist ein ausführliches Tutorial, wie du die Text-to-Speech-Funktion (Text-zu-Sprache) in der Desktop-Version von CapCut nutzt.

Die Text-to-Speech-Funktion ist eines der mächtigsten Werkzeuge in CapCut. Sie ermöglicht es dir, professionelle Voiceover zu erstellen, ohne selbst sprechen zu müssen. Das ist ideal für Tutorials, TikToks oder YouTube-Videos.


Schritt 1: Text hinzufügen

Bevor du die Sprachausgabe nutzen kannst, benötigst du einen Textclip in deinem Projekt.

  1. Öffne CapCut PC und starte ein neues Projekt.
  2. Klicke oben links im Menü auf den Reiter „Text“.
  3. Ziehe „Standardtext“ in deine Timeline oder klicke auf das kleine Plus-Symbol (+).
  4. Tippe im rechten Einstellungsfenster unter dem Reiter „Text“ den Inhalt ein, den die KI später vorlesen soll.

Schritt 2: Die Text-to-Speech-Funktion aktivieren

Sobald dein Text geschrieben ist, kannst du ihn in Sprache umwandeln:

  1. Wähle den Textclip in deiner Timeline aus, sodass er weiß umrandet ist.
  2. Schaue nun in das Panel oben rechts. Dort siehst du verschiedene Reiter (Text, Animation, Tracking etc.).
  3. Klicke auf den Reiter „Text-zu-Sprache“ (Text-to-Speech).

Schritt 3: Stimme auswählen und Vorschau anhören

Hier findest du eine große Auswahl an verschiedenen Stimmen:

  1. Sprache wählen: Du kannst oben nach Sprachen filtern (z. B. Deutsch, Englisch, Spanisch).
  2. Stimme testen: Klicke auf die verschiedenen Avatare (z. B. „Erzähler“, „Jessie“, „Energetic Male“), um eine Hörprobe der Stimme zu bekommen.
    • Hinweis: Die deutschen Stimmen sind oft unter dem Filter „Deutsch“ zu finden. Du kannst aber auch englische Stimmen für deutschen Text nutzen, was jedoch oft zu einem starken Akzent führt.
  3. Anwenden: Wenn dir eine Stimme gefällt, klicke unten rechts auf den Button „Lesen starten“ (Start reading).

Schritt 4: Die Audiospur bearbeiten

Nachdem du auf „Lesen starten“ geklickt hast, generiert CapCut eine neue Audiospur direkt unter deinem Textclip.

  • Text löschen oder behalten: Du kannst den ursprünglichen Textclip jetzt löschen, wenn du nur die Stimme hören willst. Wenn der Text als Untertitel bleiben soll, lass ihn einfach stehen.
  • Audio anpassen: Klicke auf die neu erstellte Audiospur. Im rechten Panel kannst du unter „Audio“ die Lautstärke, das Ein-/Ausblenden oder die Geschwindigkeit verändern.

Profi-Tipps für bessere Ergebnisse:

  • Rechtschreibung vs. Aussprache: Manchmal betont die KI Wörter falsch. Schreibe Wörter im Textfeld eventuell lautmalerisch (z. B. „CapKatt“ statt „CapCut“), um die Aussprache zu korrigieren.
  • Satzzeichen nutzen: Nutze Kommas und Punkte bewusst. Die KI macht an diesen Stellen kurze Pausen, was die Sprache natürlicher wirken lässt.
  • Stimmeffekte: Du kannst die generierte Stimme nachträglich noch verändern. Wähle die Audiospur aus und gehe zu „Stimmeffekte“, um die Tonhöhe zu ändern oder lustige Filter (z. B. „Tief“, „Echo“, „Roboter“) hinzuzufügen.

Zusammenfassung (Quick-Guide):

  1. Text oben links auswählen und in die Timeline ziehen.
  2. Inhalt rechts eintippen.
  3. Auf den Reiter „Text-zu-Sprache“ klicken.
  4. Stimme wählen und auf „Lesen starten“ drücken.
  5. Audiospur in der Timeline anpassen.
0