From sundial-org-awesome-openclaw-skills-4
Generates speech from text via OpenAI's Audio Speech API. Supports multiple voices, models, audio formats, and playback speed control.
How this skill is triggered — by the user, by Claude, or both
Slash command
/sundial-org-awesome-openclaw-skills-4:openai-ttsThe summary Claude sees in its skill listing — used to decide when to auto-load this skill
Generate speech from text via OpenAI's `/v1/audio/speech` endpoint.
Generate speech from text via OpenAI's /v1/audio/speech endpoint.
{baseDir}/scripts/speak.sh "Hello, world!"
{baseDir}/scripts/speak.sh "Hello, world!" --out /tmp/hello.mp3
Defaults:
tts-1 (fast) or tts-1-hd (quality)alloy (neutral), also: echo, fable, onyx, nova, shimmermp3| Voice | Description |
|---|---|
| alloy | Neutral, balanced |
| echo | Male, warm |
| fable | British, expressive |
| onyx | Deep, authoritative |
| nova | Female, friendly |
| shimmer | Female, soft |
{baseDir}/scripts/speak.sh "Text" --voice nova --model tts-1-hd --out speech.mp3
{baseDir}/scripts/speak.sh "Text" --format opus --speed 1.2
Options:
--voice <name>: alloy|echo|fable|onyx|nova|shimmer (default: alloy)--model <name>: tts-1|tts-1-hd (default: tts-1)--format <fmt>: mp3|opus|aac|flac|wav|pcm (default: mp3)--speed <n>: 0.25-4.0 (default: 1.0)--out <path>: output file (default: stdout or auto-named)Set OPENAI_API_KEY, or configure in ~/.clawdbot/clawdbot.json:
{
skills: {
entries: {
"openai-tts": {
apiKey: "sk-..."
}
}
}
}
Very affordable for short responses!
npx claudepluginhub joshuarweaver/cascade-ai-ml-agents-misc-2 --plugin sundial-org-awesome-openclaw-skills-4Generates speech audio from text via OpenRouter's OpenAI-compatible TTS API using curl or SDKs. Lists models/voices; outputs MP3/PCM bytes for voiceovers, narration, audiobooks.
Generates spoken audio from text using the OpenAI Audio API. Supports single clips and batch processing via a bundled CLI script.
Synthesizes speech from text using 6 TTS providers (OpenAI, ElevenLabs, Bailian, MiniMax, SiliconFlow, PlayHT). Supports multilingual, voice cloning, and long-form narration.