.AUDIO
Steuert Sprachausgabe, Mikrofonstatus und Sprachanweisungen (RAGAI.AUDIO).
voice akzeptiert ausschließlich ElevenLabs Voice-IDs (aus dem jeweiligen ElevenLabs-Konto), keine anderen
TTS-Anbieter-Kennungen. Ohne Angabe wird die im Bot konfigurierte bzw. zuletzt über KeyVal gespeicherte
Standardstimme verwendet (mp3BufferFromString lädt sie bei Bedarf einmalig nach und cached sie).
botSay verhält sich je nach Bot-Modus unterschiedlich: Im Avatar-/LiveAvatar-Modus wird die Anfrage an
den Avatar-Stream weitergereicht (kein lokaler Audio-Player), sonst wird lokal ein <audio>-Element erzeugt
und abgespielt. setInstruction beeinflusst nur wie zukünftige Sprachausgaben klingen (Tonlage,
Tempo, Emotion als Freitext-Anweisung an die TTS), nicht was gesagt wird.
Methoden
.say(text, voice?)
Spielt einen Text per Text-to-Speech ab.
| Parameter | Typ | Beschreibung |
|---|---|---|
text | string | z.input<typeof audioSaySchema> | Der vorzulesende Text oder ein Objekt gemäß audioSaySchema. |
voice | string | Optionale Stimme, die anstelle der konfigurierten Standardstimme verwendet wird. |
Objekt-Form (validiert über audioSaySchema):
| Feld | Typ | Pflicht | Beschreibung |
|---|---|---|---|
text | string | ✔ | Der per Text-to-Speech vorzulesende Text. |
voice | string | – | Optionale Stimme, die anstelle der konfigurierten Standardstimme verwendet wird. |
Rückgabewert: Promise<void>
Nichts.
.setText(text)
Überschreibt den angezeigten Text im Audio-Bot (audiobot_overrideText).
| Parameter | Typ | Beschreibung |
|---|---|---|
text | string | z.input<typeof audioTextSchema> | Der anzuzeigende Text oder ein Objekt gemäß audioTextSchema. |
Objekt-Form (validiert über audioTextSchema):
| Feld | Typ | Pflicht | Beschreibung |
|---|---|---|---|
text | string | ✔ | Der anzuzeigende bzw. zu verarbeitende Text. |
Rückgabewert: void
.isMicMuted()
Prüft, ob das Mikrofon aktuell stummgeschaltet ist.
Rückgabewert: boolean
true, wenn das Mikrofon stummgeschaltet ist.
.unmuteMic()
Schaltet das Mikrofon ein (Stummschaltung aufheben).
Rückgabewert: void
.muteMic()
Schaltet das Mikrofon stumm.
Rückgabewert: void
.setInstruction(text)
Speichert eine Sprachanweisung, die bei der nächsten Sprachausgabe berücksichtigt wird.
| Parameter | Typ | Beschreibung |
|---|---|---|
text | string | z.input<typeof audioTextSchema> | Die Anweisung oder ein Objekt gemäß audioTextSchema. |
Objekt-Form (validiert über audioTextSchema):
| Feld | Typ | Pflicht | Beschreibung |
|---|---|---|---|
text | string | ✔ | Der anzuzeigende bzw. zu verarbeitende Text. |
Rückgabewert: Promise<unknown>
Der gespeicherte KeyVal-Eintrag.
.getInstruction()
Liest die zuvor gespeicherte Sprachanweisung aus.
Rückgabewert: Promise<string>
Die gespeicherte Anweisung, oder ein leerer String.
.stopSpeaking()
Stoppt die aktuell laufende Sprachausgabe.
Rückgabewert: void
.botSay(text, voice?)
Spricht einen Text als Bot (per Avatar-Stream oder lokalem Audio-Player, je nach Modus).
| Parameter | Typ | Beschreibung |
|---|---|---|
text | string | z.input<typeof audioSaySchema> | Der zu sprechende Text oder ein Objekt gemäß audioSaySchema. |
voice | string | Optionale Stimme, die anstelle der konfigurierten Standardstimme verwendet wird. |
Objekt-Form (validiert über audioSaySchema):
| Feld | Typ | Pflicht | Beschreibung |
|---|---|---|---|
text | string | ✔ | Der per Text-to-Speech vorzulesende Text. |
voice | string | – | Optionale Stimme, die anstelle der konfigurierten Standardstimme verwendet wird. |
Rückgabewert: Promise<string | undefined>
Der gesprochene Text.
.mp3BufferFromString(payload, voice)
Erzeugt einen MP3-Audiopuffer aus Text per Text-to-Speech-API.
| Parameter | Typ | Beschreibung |
|---|---|---|
payload | string | Der umzuwandelnde Text. |
voice | string | undefined | Optionale Stimme; wird sonst aus der Konfiguration geladen. |
Rückgabewert: Promise<any>
Der MP3-Audiopuffer.