Dieser Inhalt ist nur für snipKI Mitglieder bestimmt.
Jetzt beitreten

Stimmen in ElevenLabs: erzeugen, klonen, verändern und wann du welchen Weg nimmst

Klicke auf die Sterne, um eine Bewertung hinzuzufügen
( 0 )
Published on 31 Sekunden ago 5 Views 0 Comments

Du willst für ein Training, ein Erklärvideo oder ein Onboarding Audio haben, ohne jedes Mal selbst vors Mikro zu müssen? ElevenLabs bietet dafür vier Wege: Stimmen aus der Bibliothek, Stimmen per Prompt, geklonte Stimmen und den Voice Changer. In diesem Snip probiere ich alle vier aus und zeige dir, welche gut funktionieren und wo es hakt. Dazu richten wir ein Aussprachewörterbuch ein, damit Namen wie snipKI auch richtig klingen.

Ergebnis: Nach diesem Snip hast du in ElevenLabs eine passende Stimme für dein Training ausgewählt oder geklont, erste Audiodateien generiert und ein Aussprachewörterbuch für deinen Firmennamen und deinen eigenen Namen hinterlegt.

AnfangerInnen
  1. Melde dich bei ElevenLabs an, geh auf “Subscription” und prüfe deinen Plan: Im Free Tier darfst du das Audio nicht kommerziell nutzen, das geht erst ab Starter. Professionelles Klonen der eigenen Stimme gibt es ab dem Creator-Plan.
  2. Kläre vorab, was du über ElevenLabs laufen lassen darfst. Das Unternehmen sitzt in den USA, Daten können also dorthin wandern, und eine Stimme ist ein personenbezogenes Datum.
  3. Öffne in ElevenCreative die Stimmen-Bibliothek, filtere nach Sprache (z. B. Deutsch), Akzent, Sprechstil wie “Konversation”, Studioqualität und Alter und hör dir die Stimmen probe. Die Tonqualität schwankt von Stimme zu Stimme deutlich.
  4. Klick bei der passenden Stimme auf “Stimme nutzen”, wähle im Text-to-Speech das neueste Stimmmodell, füge deinen Trainingstext ein und klick auf “Generieren”. Du bekommst zwei Versionen, die beste lädst du herunter.
  5. Für eine Stimme per Prompt gehst du auf “Voice Creation” und dann “Voice Design”, beschreibst Akzent und Rolle (z. B. “schüchterner Pirat mit Berliner Akzent”) und generierst. Rechne damit, dass das Ergebnis nicht ganz trifft, und jeder weitere Versuch kostet Credits.
  6. Um deine eigene Stimme zu klonen, wählst du unter “Voice Creation” das Klonen aus und lädst eine Audiodatei hoch oder nimmst direkt im Browser auf. Nutz dafür ein richtiges Mikrofon statt Earbuds oder Laptop-Mikro, die Aufnahmequalität bestimmt das Ergebnis.
  7. Gib der geklonten Stimme einen Namen, prüf Akzent, Geschlecht und Alter und speichere sie. Klone nur deine eigene Stimme oder die einer anderen Person mit deren ausdrücklicher Erlaubnis.
  8. Schließ die Voice Verification ab, indem du den angezeigten Satz einsprichst. Danach wählst du deine geklonte Stimme im Text-to-Speech aus und generierst deinen Text.
  9. Für den Voice Changer lädst du eine Aufnahme hoch oder sprichst deinen Text direkt ein und wählst eine Zielstimme. Bei deutschem Text bleibst du am besten bei einer deutschen Stimme. Deine Betonung bleibt erhalten, das Modell ist hier aber noch auf Version 2.
  10. Leg unter “Wörterbücher” ein Aussprachewörterbuch an. Die Lexikon-Datei lässt du dir von ChatGPT oder Claude erstellen, indem du beschreibst, wie Firmenname, eigener Name oder Fachbegriffe ausgesprochen werden sollen. Lade sie hoch und generiere deinen Text neu.
  1. Die vier Wege kennen, in ElevenLabs Stimmen zu erzeugen, und einschätzen, wann welcher passt.
  2. Eine Bibliotheksstimme über Filter wie Sprache, Akzent und Studioqualität finden und damit Audio generieren.
  3. Die eigene Stimme klonen und verifizieren und dabei auf gute Aufnahmequalität achten.
  4. Eine vorhandene Aufnahme mit dem Voice Changer auf eine andere Stimme umwandeln.
  5. Ein Aussprachewörterbuch anlegen, damit Firmennamen und Personennamen korrekt gesprochen werden.
  6. Datenschutz-Fragen beim Stimmklonen und bei der Datenverarbeitung in den USA einordnen.
  1. Erstellung von Hörbuchstimmen mit individuellen Akzenten und Stimmungen.
  2. Personalisierte Trainingsvideos mit geklonten Stimmen von Mitarbeitern oder Experten.
  3. Einsatz in Call-Centern, um automatisierte, natürlich klingende Sprachassistenten zu schaffen.
  4. Audio-Dubbing für multilinguale Videoformate und Präsentationen.
  5. Produktion von Podcasts oder Social Media Content mit vielfältigen Klangfarben und Charakteren.
Als nächstes
Share

Neugierig auf mehr?

Bereits über 420 praxisorientierte und kompakte KI-Tutorials warten auf dich!