| read_when |
summary |
title |
x-i18n |
| Sie möchten Inworld-Sprachsynthese für ausgehende Antworten |
| Sie benötigen PCM-Telefonie oder OGG_OPUS-Sprachnotizausgabe von Inworld |
|
Inworld Streaming-Text-to-Speech für OpenClaw-Antworten |
Inworld |
| generated_at |
model |
provider |
source_hash |
source_path |
workflow |
| 2026-04-26T11:38:00Z |
gpt-5.4 |
openai |
4c3908b6ab11fd7bd2e18e5c56d1fdc1ac2e52448538d31cc6c83c2c97917641 |
providers/inworld.md |
15 |
|
Inworld ist ein Streaming-Text-to-Speech-Provider (TTS). In OpenClaw
synthetisiert er Audio für ausgehende Antworten (standardmäßig MP3, OGG_OPUS für Sprachnotizen)
sowie PCM-Audio für Telefoniekanäle wie Voice Call.
OpenClaw sendet Anfragen an den Streaming-TTS-Endpunkt von Inworld, setzt die
zurückgegebenen base64-Audio-Chunks zu einem einzelnen Puffer zusammen und übergibt das Ergebnis
an die Standard-Pipeline für Antwort-Audio.
| Detail |
Wert |
| Website |
inworld.ai |
| Dokumentation |
docs.inworld.ai/tts/tts |
| Auth |
INWORLD_API_KEY (HTTP Basic, Base64-Dashboard-Anmeldedaten) |
| Standardstimme |
Sarah |
| Standardmodell |
inworld-tts-1.5-max |
Erste Schritte
Kopieren Sie die Anmeldedaten aus Ihrem Inworld-Dashboard (Workspace > API Keys)
und setzen Sie sie als Umgebungsvariable. Der Wert wird unverändert als HTTP-Basic-
Anmeldedatum gesendet. Kodieren Sie ihn also nicht erneut in Base64 und wandeln Sie ihn
nicht in ein Bearer-Token um.
```
INWORLD_API_KEY=<base64-credential-from-dashboard>
```
```json5
{
messages: {
tts: {
auto: "always",
provider: "inworld",
providers: {
inworld: {
voiceId: "Sarah",
modelId: "inworld-tts-1.5-max",
},
},
},
},
}
```
Senden Sie eine Antwort über einen beliebigen verbundenen Kanal. OpenClaw synthetisiert das
Audio mit Inworld und liefert es als MP3 aus (oder als OGG_OPUS, wenn der Kanal
eine Sprachnotiz erwartet).
Konfigurationsoptionen
| Option |
Pfad |
Beschreibung |
apiKey |
messages.tts.providers.inworld.apiKey |
Base64-Dashboard-Anmeldedaten. Greift auf INWORLD_API_KEY zurück. |
baseUrl |
messages.tts.providers.inworld.baseUrl |
Überschreibt die Inworld-API-baseUrl (Standard https://api.inworld.ai). |
voiceId |
messages.tts.providers.inworld.voiceId |
Kennung der Stimme (Standard Sarah). |
modelId |
messages.tts.providers.inworld.modelId |
ID des TTS-Modells (Standard inworld-tts-1.5-max). |
temperature |
messages.tts.providers.inworld.temperature |
Sampling-Temperatur 0..2 (optional). |
Hinweise
Inworld verwendet HTTP-Basic-Authentifizierung mit einer einzelnen Base64-kodierten Zeichenfolge
für Anmeldedaten. Kopieren Sie sie unverändert aus dem Inworld-Dashboard. Der Provider sendet
sie als `Authorization: Basic ` ohne weitere Kodierung. Kodieren Sie sie also nicht
selbst in Base64 und übergeben Sie kein Token im Bearer-Stil.
Unter [Hinweise zur TTS-Authentifizierung](/de/tools/tts#inworld-primary) finden Sie denselben Hinweis.
Unterstützte Modell-IDs: `inworld-tts-1.5-max` (Standard),
`inworld-tts-1.5-mini`, `inworld-tts-1-max`, `inworld-tts-1`.
Antworten verwenden standardmäßig MP3. Wenn das Kanalziel `voice-note` ist,
fordert OpenClaw bei Inworld `OGG_OPUS` an, damit das Audio als native
Sprachblase abgespielt wird. Telefonie-Synthese verwendet rohes `PCM` mit 22050 Hz, um
die Telefonie-Bridge zu speisen.
Überschreiben Sie den API-Host mit `messages.tts.providers.inworld.baseUrl`.
Nachgestellte Schrägstriche werden entfernt, bevor Anfragen gesendet werden.
Verwandt
TTS-Übersicht, Provider und Konfiguration von `messages.tts`.
Vollständige Konfigurationsreferenz einschließlich der Einstellungen für `messages.tts`.
Alle gebündelten OpenClaw Provider.
Häufige Probleme und Schritte zur Fehlerbehebung.