Skip to main content

.AUDIO

Steuert Sprachausgabe, Mikrofonstatus und Sprachanweisungen (RAGAI.AUDIO).

Hintergrund

voice akzeptiert ausschließlich ElevenLabs Voice-IDs (aus dem jeweiligen ElevenLabs-Konto), keine anderen TTS-Anbieter-Kennungen. Ohne Angabe wird die im Bot konfigurierte bzw. zuletzt über KeyVal gespeicherte Standardstimme verwendet (mp3BufferFromString lädt sie bei Bedarf einmalig nach und cached sie). botSay verhält sich je nach Bot-Modus unterschiedlich: Im Avatar-/LiveAvatar-Modus wird die Anfrage an den Avatar-Stream weitergereicht (kein lokaler Audio-Player), sonst wird lokal ein <audio>-Element erzeugt und abgespielt. setInstruction beeinflusst nur wie zukünftige Sprachausgaben klingen (Tonlage, Tempo, Emotion als Freitext-Anweisung an die TTS), nicht was gesagt wird.

Methoden

.say(text, voice?)

Spielt einen Text per Text-to-Speech ab.

ParameterTypBeschreibung
textstring | z.input<typeof audioSaySchema>Der vorzulesende Text oder ein Objekt gemäß audioSaySchema.
voicestringOptionale Stimme, die anstelle der konfigurierten Standardstimme verwendet wird.

Objekt-Form (validiert über audioSaySchema):

FeldTypPflichtBeschreibung
textstringDer per Text-to-Speech vorzulesende Text.
voicestringOptionale Stimme, die anstelle der konfigurierten Standardstimme verwendet wird.

Rückgabewert: Promise<void>

Nichts.

.setText(text)

Überschreibt den angezeigten Text im Audio-Bot (audiobot_overrideText).

ParameterTypBeschreibung
textstring | z.input<typeof audioTextSchema>Der anzuzeigende Text oder ein Objekt gemäß audioTextSchema.

Objekt-Form (validiert über audioTextSchema):

FeldTypPflichtBeschreibung
textstringDer anzuzeigende bzw. zu verarbeitende Text.

Rückgabewert: void

.isMicMuted()

Prüft, ob das Mikrofon aktuell stummgeschaltet ist.

Rückgabewert: boolean

true, wenn das Mikrofon stummgeschaltet ist.

.unmuteMic()

Schaltet das Mikrofon ein (Stummschaltung aufheben).

Rückgabewert: void

.muteMic()

Schaltet das Mikrofon stumm.

Rückgabewert: void

.setInstruction(text)

Speichert eine Sprachanweisung, die bei der nächsten Sprachausgabe berücksichtigt wird.

ParameterTypBeschreibung
textstring | z.input<typeof audioTextSchema>Die Anweisung oder ein Objekt gemäß audioTextSchema.

Objekt-Form (validiert über audioTextSchema):

FeldTypPflichtBeschreibung
textstringDer anzuzeigende bzw. zu verarbeitende Text.

Rückgabewert: Promise<unknown>

Der gespeicherte KeyVal-Eintrag.

.getInstruction()

Liest die zuvor gespeicherte Sprachanweisung aus.

Rückgabewert: Promise<string>

Die gespeicherte Anweisung, oder ein leerer String.

.stopSpeaking()

Stoppt die aktuell laufende Sprachausgabe.

Rückgabewert: void

.botSay(text, voice?)

Spricht einen Text als Bot (per Avatar-Stream oder lokalem Audio-Player, je nach Modus).

ParameterTypBeschreibung
textstring | z.input<typeof audioSaySchema>Der zu sprechende Text oder ein Objekt gemäß audioSaySchema.
voicestringOptionale Stimme, die anstelle der konfigurierten Standardstimme verwendet wird.

Objekt-Form (validiert über audioSaySchema):

FeldTypPflichtBeschreibung
textstringDer per Text-to-Speech vorzulesende Text.
voicestringOptionale Stimme, die anstelle der konfigurierten Standardstimme verwendet wird.

Rückgabewert: Promise<string | undefined>

Der gesprochene Text.

.mp3BufferFromString(payload, voice)

Erzeugt einen MP3-Audiopuffer aus Text per Text-to-Speech-API.

ParameterTypBeschreibung
payloadstringDer umzuwandelnde Text.
voicestring | undefinedOptionale Stimme; wird sonst aus der Konfiguration geladen.

Rückgabewert: Promise<any>

Der MP3-Audiopuffer.