Skip to content

feat: text-to-speech (Speak) for OpenAI and Gemini - #10

Merged
jkyberneees merged 5 commits into
mainfrom
feat/tts
Sep 23, 2026
Merged

jkyberneees merged 5 commits into
mainfrom
feat/tts

Conversation

@jkyberneees

Copy link
Copy Markdown
Contributor

Adds SDK.Speak(ctx, provider, model, SpeakRequest) — TTS for OpenAI-compatible /audio/speech and Gemini AUDIO-modality generateContent.

  • No transcoding: provider bytes + declared MIME (audio/mpeg fallback)
  • Chat retry ladder + error taxonomy; 50MB read cap; keys never in errors
  • Empty Text/Voice fail fast (ConfigError); 2xx JSON envelopes rejected as typed errors
  • RED-first unit suite (httptest), e2e arms behind the e2e tag (skip without keys)
  • README + AGENTS.md updated in-branch

Verified: go vet (+e2e tags), go test -race -count=1 green; live OpenAI TTS e2e passed (31KB audio/mpeg). Adversarially reviewed; both findings fixed (empty-inlineData rejection, ctx parameter).

@jkyberneees
jkyberneees merged commit 064d9a2 into main Sep 23, 2026
7 checks passed
@jkyberneees
jkyberneees deleted the feat/tts branch September 23, 2026 11:16
Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant