Defined in: packages/ai/src/types.ts:2475
Result of text-to-speech generation.
optional alignment?: TTSAlignment;Defined in: packages/ai/src/types.ts:2490
Character- or word-level timings, present when timestamps: true was requested. Use this rather than duration to find where speech ends.
optional artifacts?: PersistedArtifactRef[];Defined in: packages/ai/src/types.ts:2501
Persisted artifact references for generated assets, when available
audio: string;Defined in: packages/ai/src/types.ts:2481
Base64-encoded audio data
optional contentType?: string;Defined in: packages/ai/src/types.ts:2497
Content type of the audio (e.g., 'audio/mp3')
optional duration?: number;Defined in: packages/ai/src/types.ts:2485
Duration of the audio file in seconds, if available
format: string;Defined in: packages/ai/src/types.ts:2483
Audio format of the generated audio
id: string;Defined in: packages/ai/src/types.ts:2477
Unique identifier for the generation
model: string;Defined in: packages/ai/src/types.ts:2479
Model used for generation
optional segments?: TTSSegment[];Defined in: packages/ai/src/types.ts:2495
Per-turn (or per-utterance) spans of the audio, present when timestamps: true was requested and the provider reports segmentation.
optional usage?: TokenUsage<ProviderUsageDetails>;Defined in: packages/ai/src/types.ts:2499
Token usage information (if provided by the adapter)