KI-Audio-Generierung
Statt eigene Audiodateien zu beschaffen und zu hosten, kannst du Text-to-Speech-Ansagen und Hintergrundmusik für Sprachsupport direkt im Sprachsupport-Dashboard erzeugen. Erzeugte Clips werden in der Dateibibliothek deines Servers gespeichert, erscheinen in der Audioauswahl für deine Wartemusik- und Geschlossen-Playlists und werden in AI Coins vom Guthaben deines Servers abgerechnet.
Wo du es findest
Immer wenn das Dashboard eine Audioauswahl anzeigt - für die Wartemusik oder die Playlist der Musik für den geschlossenen Zustand - siehst du neben Deine Uploads und SCNX-Bibliothek den Tab Generieren (KI). Dieser teilt sich weiter in Text-to-Speech und Musik auf.
Beide Werkzeuge funktionieren gleich:
- Gib deinen Prompt ein (Text für TTS; eine Beschreibung für Musik).
- Prüfe die Live-Kostenschätzung in AI Coins und dein aktuelles Guthaben.
- Klicke auf Generieren. Die Wartezeit beträgt bei TTS meist einige Sekunden, bei Musik bis zu einer Minute.
- Höre dir das Ergebnis mit dem integrierten Abspielknopf an.
- Der Clip wird automatisch in deiner Dateibibliothek registriert und der Playlist hinzugefügt, die du gerade bearbeitest. Wenn du möchtest, kannst du den Clip auch herunterladen und später manuell hinzufügen.
Da KI-erzeugte Titel mit AI Coins bezahlt werden, belegen sie keinen Teil des Dateispeicher-Kontingents deines Servers - egal wie viele du erzeugst, dir geht durch KI-Audio kein Speicherplatz aus. Titel, die du selbst hochlädst, zählen wie jede andere Datei zum Kontingent.
Text-to-Speech (TTS)
Nützlich für Begrüßungen, Ansagen bei geschlossener Warteschlange, Sprachansagen in der Warteschleife und alle anderen gesprochenen Inhalte. Erzeugt mit ElevenLabs-Stimmen.
So funktioniert es
- Wähle eine Sprache. Die Auswahl verwendet standardmäßig deine Browsersprache, falls verfügbar, und zeigt neben jeder Sprache eine Anzahl an.
- Aktiviere optional Zeige auch mehrsprachige Stimmen an, um Stimmen hinzuzufügen, die in jeder Sprache funktionieren (praktisch für gemischtsprachige Warteschlangen).
- Wähle eine Stimme. Jede Stimmenkarte zeigt den Namen der Stimme, ein Akzent-Label, ein kurzes Einsatz-Tag und einen Vorschau-Knopf. Du kannst dir die Vorschau anhören, bevor du die Stimme auswählst.
- Gib den Text ein, der gesprochen werden soll - bis zu 10.000 Zeichen.
- Klicke auf Generieren. Die Kosten werden anhand der Textlänge berechnet (siehe Preise unten).
Preise
| Element | Wert |
|---|---|
| Kostensatz | 1 AI Coin pro 4 Zeichen (aufgerundet), mindestens 1 Coin. |
| Maximale Textlänge | 10.000 Zeichen pro Generierung. |
Die genauen Kosten werden live während der Eingabe angezeigt, und der Knopf ist deaktiviert, wenn dein Guthaben nicht ausreicht. Fehlt dir Guthaben, erscheint ein Link „KI-Guthaben kaufen".
Musik
Nützlich, um Wartemusik zu erstellen, die zur Stimmung deines Servers passt, ohne lizenzierte Titel beschaffen zu müssen. Erzeugt mit dem Musikmodell von ElevenLabs.
So funktioniert es
- Schreibe einen Musik-Prompt, der Stimmung, Instrumentierung, Tempo und Atmosphäre beschreibt - z.B. „warm lo-fi beat, mellow piano, soft drums, 70 BPM, no vocals". Bis zu 4.100 Zeichen.
- Wähle eine Dauer zwischen 3 Sekunden und 5 Minuten (Standard: 60 Sekunden).
- Klicke auf Generieren. Die Musikgenerierung dauert länger als TTS - die Oberfläche zeigt eine Fortschrittsanzeige.
Preise
| Element | Wert |
|---|---|
| Kostensatz | 12 AI Coins pro Sekunde (= 600 Coins pro Minute). |
| Dauerbereich | 3 Sekunden bis 300 Sekunden (5 Minuten) pro Generierung. |
Auch hier aktualisiert sich die Live-Kostenvorschau, wenn du den Dauer-Regler verschiebst, und der Knopf ist deaktiviert, wenn du dir die Generierung nicht leisten kannst.
Tipps
- Baue mit der Zeit eine Bibliothek auf. Generierungen werden in deiner Dateibibliothek gespeichert, auch nachdem du das Dashboard schließt. Du musst eine Begrüßung nicht jedes Mal neu erzeugen - verwende den gespeicherten Clip erneut.
- Mische KI- und hochgeladene Titel. Die Playlist ist nur eine Liste von URLs. Du kannst KI-erzeugte Titel frei mit selbst hochgeladenen Dateien mischen.
- Höre vor dem Hinzufügen rein. Die integrierte Vorschau spielt exakt das Audio ab, das später im Sprachkanal läuft - was du hörst, hören auch deine Nutzer.
- Halte TTS kurz. Lange Ansagen brauchen länger zum Rendern und kosten pro Klick mehr. Für Begrüßungen und Warteschlangen-Ansagen sind kürzere Texte fast immer besser.
- Verfeinere Musik-Prompts. Die Musikgenerierung ist nicht deterministisch - derselbe Prompt erzeugt bei jedem Durchlauf andere Clips. Passt das erste Ergebnis nicht, ändere den Prompt (ergänze „instrumental", „no vocals", „loopable") und erzeuge neu.
Moderation und Fehler
Beide Generatoren prüfen jede Anfrage mit einer Sicherheitsprüfung. Wird der Prompt abgelehnt, siehst du eine klare Moderationsmeldung und es werden keine Coins abgezogen. Weitere Fehler, die die Oberfläche anzeigt:
| Situation | Was du siehst |
|---|---|
| Nicht genug AI Coins | Der Generieren-Knopf ist deaktiviert und ein Link „KI-Guthaben kaufen" erscheint. |
| Generierung abgelehnt (Richtlinie) | „Your prompt was rejected by moderation" oder ähnlich - Coins werden nicht abgerechnet. |
| Zu viele gleichzeitige Anfragen | Ein Hinweis „currently busy" - versuche es in einigen Sekunden erneut. |
| Allgemeiner Fehler | Eine einzeilige Fehlermeldung. Wenn sie bestehen bleibt, melde dich unter scnx.app/help. |
Siehe auch
- Konfiguration der Wartemusik - hier fügt sich KI-erzeugte Musik in die Playlist für den geöffneten Zustand ein.
- Musik für den geschlossenen Zustand - dieselbe Auswahl, andere Playlist, die abgespielt wird, wenn Sprachsupport offline ist.
- AI Coins (FAQ) - wie AI Coins bepreist und gekauft werden.