Heute veröffentlichen wir AI Voice Generation v2 — ein Text-zu-Sprache- und Stimmklon-Studio, basierend auf dem plattformübergreifenden AI Suite v2 Stack. Geben Sie beliebigen Text ein und hören Sie ihn in einer natürlichen Stimme, oder nehmen Sie einen kurzen Clip auf und erstellen Sie eine individuelle Stimme, die wie Sie klingt, um sie jederzeit wiederzuverwenden. Das Ziel ist einfach: Text in Sprache verwandeln – und Ihre eigene Stimme klonen – ohne Ihr Skript oder Ihre Stimmproben in die Cloud zu senden.

Was es kann

Fügen Sie einen Satz, einen Absatz oder ein ganzes Skript ein; wählen Sie eine Stimme; drücken Sie auf Generieren; und hören Sie natürliche Sprache. Die integrierte Amy Stimme läuft vollständig offline auf Ihrem Gerät, sobald das kleine Modell beim ersten Gebrauch heruntergeladen wurde – schalten Sie das Netzwerk aus, und es funktioniert weiterhin. Passen Sie die Sprechgeschwindigkeit von 0,5× bis 2,0× ohne Tonhöhenänderung an, wählen Sie Ihr Ausgabeformat und spielen Sie Ihren letzten Clip sofort mit einem durchsuchbaren Wellenform-Player ab. Wenn Ihnen ein Ergebnis gefällt, speichern Sie es als WAV- oder MP3-Datei.

Sie möchten eine bestimmte Stimme? Nehmen Sie einen kurzen Referenzclip auf oder laden Sie ihn hoch, und die App erstellt eine individuelle geklonte Stimme — kein Trainingsschritt, kein Studio. Ihre Klone erscheinen oben im Stimmenauswahlmenü zur sofortigen Wiederverwendung, sodass eine konsistente Stimme in jedem von Ihnen erstellten Clip verwendet wird.

Neu in Version 2

  • Eine echte Stimmenbibliothek. Ein durchsuchbarer Auswahldialog vereint die offline integrierte Stimme, Premium-Cloud-Stimmen, hochwertige neuronale Stimmen auf dem Gerät und Ihre eigenen Klone. Ein Schnellfilter verengt die Liste beim Tippen nach Name oder Sprache, und ein Download-Symbol zeigt, welche Stimmen ihre Dateien beim ersten Gebrauch herunterladen.
  • Stimmenklonen, Ihr erster Klon kostenlos. Nehmen Sie 6–15 Sekunden saubere Sprache auf (oder importieren Sie einen Clip), benennen Sie die Stimme und erstellen Sie mit der kostenlosen Chatterbox-Engine einen Klon. Dieser erscheint ganz oben im Auswahldialog ohne Pro-Symbol – eine echte individuelle Stimme, kein Test.
  • Engines für jede Situation. Die offline Piper-Engine ist die Standardeinstellung und läuft vollständig auf Ihrem Gerät. Pro schaltet weitere Piper-Stimmen, OpenAI-kompatible Cloud-Stimmen (bringen Sie Ihren eigenen Schlüssel mit) und neuronale Stimmen auf dem Gerät frei – Kokoro (leicht und schnell) und Parler-TTS – die lokal bleiben. Eine Option zum Laden der Modelle im Speicher sorgt dafür, dass wiederholte Generierungen die Ladezeit überspringen.
  • Wiedergabe ohne erneute Synthese. Ein Wellenform-Player spielt Ihren zuletzt generierten Clip und Ihre Klon-Referenzclips sofort ab, sodass Sie nicht erneut generieren müssen, um erneut zuzuhören. Sie entscheiden, wie viele der letzten Clips zwischengespeichert bleiben.
  • Schwere Arbeit auslagern, wann Sie wollen. Das Klonen erfordert viel Rechenleistung; wenn dieser Rechner keine schnelle GPU hat, können Sie es an einen AI Server in Ihrem Netzwerk auslagern. Selbst dann bleibt Ihr Referenzclip auf Ihrem Gerät verschlüsselt – eine einmalige Kopie wird nur zur Synthese jeder Anfrage gesendet und niemals auf dem Server gespeichert.
  • In 16 Sprachen. Die gesamte Benutzeroberfläche folgt der Sprache Ihres Betriebssystems, mit einem Ein-Klick-Wechsel in den Einstellungen, und sie spricht und klont in vielen Sprachen.
  • Skriptfähig. Ein kopfloses Kommandozeilen-Tool erzeugt Sprache vom Terminal aus, für Batch-Voiceovers und Automatisierung auf Ihrer eigenen Infrastruktur.

Kostenlos vs. Pro

Die kostenlose Stufe ist wirklich eigenständig nutzbar – sie bietet Ihnen eine echte Stimme und eine echte geklonte Stimme. Kostenlos beinhaltet die offline Amy Stimme und deine erste geklonte Stimmeerstellt mit der kostenlosen Klon-Engine, ohne Nutzungsbegrenzung und ohne Abrechnung pro Wort. Pro steht für mehr Auswahl: jede andere integrierte Stimme, Premium-Cloud-Stimmen, hochwertige neuronale Stimmen auf dem Gerät, die fortschrittlichen Klon-Engines und unbegrenzte Klone über deinen ersten hinaus. Das Klonen von Stimmen selbst ist nicht hinter Pro gesperrt – die Basis-Engine ist kostenlos, und du kannst einen Klon im kostenlosen Tarif verwenden; Pro fügt einfach mehr Klone und mehr Engines hinzu.

Warum On-Device wichtig ist

Skripte, Erzählungen, eine Stimme, die wie du klingt – die Texte und Stimmproben, mit denen die meisten Menschen am liebsten arbeiten möchten, sind oft genau das, was nicht an eine Drittanbieter-Cloud gesendet werden darf. AI Voice Generation bringt die KI stattdessen auf dein Gerät: die Offline-Stimme Amy und deine Klone auf dem Gerät senden nichts vom Gerät weg, deine Klon-Referenzclips und die Generierungshistorie sind im Ruhezustand verschlüsselt unter einem Schlüssel, den nur deine AI Suite-Apps lesen können, und es gibt keinen Zähler pro Zeichen. Nur die optionalen Cloud-Stimmen und das optionale Klon-Auslagern senden jemals etwas online, und beides ist eine explizite Opt-in-Option. Es ist dasselbe On-Premises-, Datenschutz-zuerst-Prinzip, das hinter allem steht, was Software Tailor entwickelt [1].

Hol es dir

AI Voice Generation v2 ist jetzt im Microsoft Store für Windows als kostenloser Download verfügbar, mit Pro, wenn du die vollständige Stimmenbibliothek und unbegrenzte Klone möchtest [2] . Weitere Plattformversionen werden erst als verfügbar präsentiert, wenn ein verifizierter öffentlicher Erwerbspfad besteht. Lies die vollständige Feature-Tour auf der Produktseite.