@tanstack/ai
Version:
Type-safe TypeScript AI SDK for streaming chat, tool calling, agents, structured outputs, and multimodal generation.
168 lines (167 loc) • 4.56 kB
JavaScript
import { resolveDebugOption } from "../../logger/resolve.js";
import { streamGenerationResult } from "../stream-generation-result.js";
import { applyGenerationResultTransforms, createGenerationContext, runGenerationError, runGenerationFinish, runGenerationStart, runGenerationUsage } from "../middleware/run.js";
import "./adapter.js";
import { aiEventClient } from "@tanstack/ai-event-client";
//#region src/activities/generateSpeech/index.ts
/**
* TTS Activity
*
* Generates speech audio from text using text-to-speech models.
* This is a self-contained module with implementation, types, and JSDoc.
*/
/** The adapter kind this activity handles */
var kind = "tts";
function createId(prefix) {
return `${prefix}-${Date.now()}-${Math.random().toString(36).slice(2, 9)}`;
}
/**
* TTS activity - generates speech from text.
*
* Uses AI text-to-speech models to create audio from natural language text.
*
* @example Generate speech from text
* ```ts
* import { generateSpeech } from '@tanstack/ai'
* import { openaiSpeech } from '@tanstack/ai-openai'
*
* const result = await generateSpeech({
* adapter: openaiSpeech('tts-1-hd'),
* text: 'Hello, welcome to TanStack AI!',
* voice: 'nova'
* })
*
* console.log(result.audio) // base64-encoded audio
* ```
*
* @example With format and speed options
* ```ts
* const result = await generateSpeech({
* adapter: openaiSpeech('tts-1'),
* text: 'This is slower speech.',
* voice: 'alloy',
* format: 'wav',
* speed: 0.8
* })
* ```
*/
function generateSpeech(options) {
if (options.stream) return streamGenerationResult((resolved) => runGenerateSpeech({
...options,
runId: resolved.runId
}), options);
return runGenerateSpeech(options);
}
/**
* Run the core TTS generation logic (non-streaming).
*/
async function runGenerateSpeech(options) {
const { adapter, stream: _stream, debug: _debug, middleware, threadId, runId, ...rest } = options;
const model = adapter.model;
const requestId = createId("speech");
const startTime = Date.now();
const logger = resolveDebugOption(options.debug);
const providerName = adapter.provider ?? adapter.name ?? "unknown";
const mwCtx = createGenerationContext({
requestId,
activity: "tts",
provider: adapter.name,
model,
modelOptions: rest.modelOptions,
artifactInputs: {
text: rest.text,
voice: rest.voice,
format: rest.format,
speed: rest.speed
},
threadId,
runId,
createId
});
await runGenerationStart(middleware, mwCtx);
aiEventClient.emit("speech:request:started", {
requestId,
provider: adapter.name,
model,
text: rest.text,
voice: rest.voice,
format: rest.format,
speed: rest.speed,
modelOptions: rest.modelOptions,
timestamp: startTime
});
logger.request(`activity=generateSpeech provider=${providerName}`, {
provider: providerName,
model
});
try {
const result = await applyGenerationResultTransforms(mwCtx, await adapter.generateSpeech({
...rest,
model,
logger
}));
const duration = Date.now() - startTime;
aiEventClient.emit("speech:request:completed", {
requestId,
provider: adapter.name,
model,
audio: result.audio,
format: result.format,
audioDuration: result.duration,
contentType: result.contentType,
duration,
modelOptions: rest.modelOptions,
timestamp: Date.now()
});
if (result.usage) aiEventClient.emit("speech:usage", {
requestId,
model,
usage: result.usage,
modelOptions: rest.modelOptions,
timestamp: Date.now()
});
logger.output(`activity=generateSpeech bytes=${result.audio.length}`, {
bytes: result.audio.length,
contentType: result.contentType
});
if (result.usage) await runGenerationUsage(middleware, mwCtx, result.usage);
await runGenerationFinish(middleware, mwCtx, {
duration,
usage: result.usage
});
return result;
} catch (error) {
const duration = Date.now() - startTime;
const err = error;
aiEventClient.emit("speech:request:error", {
requestId,
provider: adapter.name,
model,
error: {
message: err.message,
name: err.name
},
duration,
modelOptions: rest.modelOptions,
timestamp: Date.now()
});
await runGenerationError(middleware, mwCtx, {
error,
duration
});
logger.errors("generateSpeech activity failed", {
error,
source: "generateSpeech"
});
throw error;
}
}
/**
* Create typed options for the generateSpeech() function without executing.
*/
function createSpeechOptions(options) {
return options;
}
//#endregion
export { createSpeechOptions, generateSpeech, kind };
//# sourceMappingURL=index.js.map