UNPKG

@tanstack/ai

Version:

Type-safe TypeScript AI SDK for streaming chat, tool calling, agents, structured outputs, and multimodal generation.

168 lines (167 loc) 4.56 kB
import { resolveDebugOption } from "../../logger/resolve.js"; import { streamGenerationResult } from "../stream-generation-result.js"; import { applyGenerationResultTransforms, createGenerationContext, runGenerationError, runGenerationFinish, runGenerationStart, runGenerationUsage } from "../middleware/run.js"; import "./adapter.js"; import { aiEventClient } from "@tanstack/ai-event-client"; //#region src/activities/generateSpeech/index.ts /** * TTS Activity * * Generates speech audio from text using text-to-speech models. * This is a self-contained module with implementation, types, and JSDoc. */ /** The adapter kind this activity handles */ var kind = "tts"; function createId(prefix) { return `${prefix}-${Date.now()}-${Math.random().toString(36).slice(2, 9)}`; } /** * TTS activity - generates speech from text. * * Uses AI text-to-speech models to create audio from natural language text. * * @example Generate speech from text * ```ts * import { generateSpeech } from '@tanstack/ai' * import { openaiSpeech } from '@tanstack/ai-openai' * * const result = await generateSpeech({ * adapter: openaiSpeech('tts-1-hd'), * text: 'Hello, welcome to TanStack AI!', * voice: 'nova' * }) * * console.log(result.audio) // base64-encoded audio * ``` * * @example With format and speed options * ```ts * const result = await generateSpeech({ * adapter: openaiSpeech('tts-1'), * text: 'This is slower speech.', * voice: 'alloy', * format: 'wav', * speed: 0.8 * }) * ``` */ function generateSpeech(options) { if (options.stream) return streamGenerationResult((resolved) => runGenerateSpeech({ ...options, runId: resolved.runId }), options); return runGenerateSpeech(options); } /** * Run the core TTS generation logic (non-streaming). */ async function runGenerateSpeech(options) { const { adapter, stream: _stream, debug: _debug, middleware, threadId, runId, ...rest } = options; const model = adapter.model; const requestId = createId("speech"); const startTime = Date.now(); const logger = resolveDebugOption(options.debug); const providerName = adapter.provider ?? adapter.name ?? "unknown"; const mwCtx = createGenerationContext({ requestId, activity: "tts", provider: adapter.name, model, modelOptions: rest.modelOptions, artifactInputs: { text: rest.text, voice: rest.voice, format: rest.format, speed: rest.speed }, threadId, runId, createId }); await runGenerationStart(middleware, mwCtx); aiEventClient.emit("speech:request:started", { requestId, provider: adapter.name, model, text: rest.text, voice: rest.voice, format: rest.format, speed: rest.speed, modelOptions: rest.modelOptions, timestamp: startTime }); logger.request(`activity=generateSpeech provider=${providerName}`, { provider: providerName, model }); try { const result = await applyGenerationResultTransforms(mwCtx, await adapter.generateSpeech({ ...rest, model, logger })); const duration = Date.now() - startTime; aiEventClient.emit("speech:request:completed", { requestId, provider: adapter.name, model, audio: result.audio, format: result.format, audioDuration: result.duration, contentType: result.contentType, duration, modelOptions: rest.modelOptions, timestamp: Date.now() }); if (result.usage) aiEventClient.emit("speech:usage", { requestId, model, usage: result.usage, modelOptions: rest.modelOptions, timestamp: Date.now() }); logger.output(`activity=generateSpeech bytes=${result.audio.length}`, { bytes: result.audio.length, contentType: result.contentType }); if (result.usage) await runGenerationUsage(middleware, mwCtx, result.usage); await runGenerationFinish(middleware, mwCtx, { duration, usage: result.usage }); return result; } catch (error) { const duration = Date.now() - startTime; const err = error; aiEventClient.emit("speech:request:error", { requestId, provider: adapter.name, model, error: { message: err.message, name: err.name }, duration, modelOptions: rest.modelOptions, timestamp: Date.now() }); await runGenerationError(middleware, mwCtx, { error, duration }); logger.errors("generateSpeech activity failed", { error, source: "generateSpeech" }); throw error; } } /** * Create typed options for the generateSpeech() function without executing. */ function createSpeechOptions(options) { return options; } //#endregion export { createSpeechOptions, generateSpeech, kind }; //# sourceMappingURL=index.js.map