@ai-sdk/provider 4.0.1 → 4.0.2
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/CHANGELOG.md +6 -0
- package/dist/index.d.ts +169 -3
- package/package.json +1 -1
- package/src/transcription-model/v4/index.ts +3 -0
- package/src/transcription-model/v4/transcription-model-v4-stream-options.ts +52 -0
- package/src/transcription-model/v4/transcription-model-v4-stream-part.ts +85 -0
- package/src/transcription-model/v4/transcription-model-v4-stream-result.ts +47 -0
- package/src/transcription-model/v4/transcription-model-v4.ts +14 -0
package/CHANGELOG.md
CHANGED
package/dist/index.d.ts
CHANGED
|
@@ -5086,7 +5086,7 @@ type SpeechModelV4 = {
|
|
|
5086
5086
|
doGenerate(options: SpeechModelV4CallOptions): PromiseLike<SpeechModelV4Result>;
|
|
5087
5087
|
};
|
|
5088
5088
|
|
|
5089
|
-
type TranscriptionModelV4ProviderOptions = Record<string, JSONObject>;
|
|
5089
|
+
type TranscriptionModelV4ProviderOptions$1 = Record<string, JSONObject>;
|
|
5090
5090
|
type TranscriptionModelV4CallOptions = {
|
|
5091
5091
|
/**
|
|
5092
5092
|
* Audio data to transcribe.
|
|
@@ -5113,7 +5113,7 @@ type TranscriptionModelV4CallOptions = {
|
|
|
5113
5113
|
* }
|
|
5114
5114
|
* ```
|
|
5115
5115
|
*/
|
|
5116
|
-
providerOptions?: TranscriptionModelV4ProviderOptions;
|
|
5116
|
+
providerOptions?: TranscriptionModelV4ProviderOptions$1;
|
|
5117
5117
|
/**
|
|
5118
5118
|
* Abort signal for cancelling the operation.
|
|
5119
5119
|
*/
|
|
@@ -5204,6 +5204,163 @@ type TranscriptionModelV4Result = {
|
|
|
5204
5204
|
providerMetadata?: Record<string, JSONObject>;
|
|
5205
5205
|
};
|
|
5206
5206
|
|
|
5207
|
+
type TranscriptionModelV4ProviderOptions = Record<string, JSONObject>;
|
|
5208
|
+
type TranscriptionModelV4StreamOptions = {
|
|
5209
|
+
/**
|
|
5210
|
+
* Audio chunks to transcribe.
|
|
5211
|
+
*
|
|
5212
|
+
* `Uint8Array` chunks contain raw audio bytes. `string` chunks contain
|
|
5213
|
+
* base64-encoded raw audio bytes.
|
|
5214
|
+
*/
|
|
5215
|
+
audio: ReadableStream<Uint8Array | string>;
|
|
5216
|
+
/**
|
|
5217
|
+
* The input audio format for the raw audio chunks.
|
|
5218
|
+
*/
|
|
5219
|
+
inputAudioFormat: {
|
|
5220
|
+
/**
|
|
5221
|
+
* Audio format type, e.g. `audio/pcm`, `audio/pcmu`, or `audio/pcma`.
|
|
5222
|
+
*/
|
|
5223
|
+
type: string;
|
|
5224
|
+
/**
|
|
5225
|
+
* Sample rate in Hz. Only applicable for formats that require a rate.
|
|
5226
|
+
*/
|
|
5227
|
+
rate?: number;
|
|
5228
|
+
};
|
|
5229
|
+
/**
|
|
5230
|
+
* Additional provider-specific options that are passed through to the provider.
|
|
5231
|
+
*
|
|
5232
|
+
* The outer record is keyed by the provider name, and the inner record is keyed
|
|
5233
|
+
* by provider-specific option names.
|
|
5234
|
+
*/
|
|
5235
|
+
providerOptions?: TranscriptionModelV4ProviderOptions;
|
|
5236
|
+
/**
|
|
5237
|
+
* Abort signal for cancelling the operation.
|
|
5238
|
+
*/
|
|
5239
|
+
abortSignal?: AbortSignal;
|
|
5240
|
+
/**
|
|
5241
|
+
* Additional HTTP headers to be sent with the request.
|
|
5242
|
+
* Only applicable for HTTP/WebSocket-based providers that support headers.
|
|
5243
|
+
*/
|
|
5244
|
+
headers?: Record<string, string | undefined>;
|
|
5245
|
+
/**
|
|
5246
|
+
* When true, providers should include raw provider chunks in the stream.
|
|
5247
|
+
*/
|
|
5248
|
+
includeRawChunks?: boolean;
|
|
5249
|
+
};
|
|
5250
|
+
|
|
5251
|
+
type TranscriptionModelV4StreamPart = {
|
|
5252
|
+
/**
|
|
5253
|
+
* Stream start event with warnings for the call, e.g. unsupported settings.
|
|
5254
|
+
*/
|
|
5255
|
+
type: 'stream-start';
|
|
5256
|
+
warnings: Array<SharedV4Warning>;
|
|
5257
|
+
} | {
|
|
5258
|
+
/**
|
|
5259
|
+
* Append-only transcript delta.
|
|
5260
|
+
*/
|
|
5261
|
+
type: 'transcript-delta';
|
|
5262
|
+
id?: string;
|
|
5263
|
+
delta: string;
|
|
5264
|
+
providerMetadata?: SharedV4ProviderMetadata;
|
|
5265
|
+
} | {
|
|
5266
|
+
/**
|
|
5267
|
+
* Non-final transcript text. The text may be revised by later parts.
|
|
5268
|
+
*/
|
|
5269
|
+
type: 'transcript-partial';
|
|
5270
|
+
id?: string;
|
|
5271
|
+
text: string;
|
|
5272
|
+
startSecond?: number;
|
|
5273
|
+
durationInSeconds?: number;
|
|
5274
|
+
channelIndex?: number;
|
|
5275
|
+
providerMetadata?: SharedV4ProviderMetadata;
|
|
5276
|
+
} | {
|
|
5277
|
+
/**
|
|
5278
|
+
* Final transcript text for a provider-defined segment or utterance.
|
|
5279
|
+
*/
|
|
5280
|
+
type: 'transcript-final';
|
|
5281
|
+
id?: string;
|
|
5282
|
+
text: string;
|
|
5283
|
+
startSecond?: number;
|
|
5284
|
+
endSecond?: number;
|
|
5285
|
+
channelIndex?: number;
|
|
5286
|
+
providerMetadata?: SharedV4ProviderMetadata;
|
|
5287
|
+
} | {
|
|
5288
|
+
/**
|
|
5289
|
+
* Metadata for the response, emitted once available.
|
|
5290
|
+
*/
|
|
5291
|
+
type: 'response-metadata';
|
|
5292
|
+
timestamp?: Date;
|
|
5293
|
+
modelId?: string;
|
|
5294
|
+
headers?: SharedV4Headers;
|
|
5295
|
+
body?: unknown;
|
|
5296
|
+
} | {
|
|
5297
|
+
/**
|
|
5298
|
+
* Metadata that is available after the stream is finished.
|
|
5299
|
+
*/
|
|
5300
|
+
type: 'finish';
|
|
5301
|
+
text: string;
|
|
5302
|
+
segments: Array<{
|
|
5303
|
+
text: string;
|
|
5304
|
+
startSecond: number;
|
|
5305
|
+
endSecond: number;
|
|
5306
|
+
}>;
|
|
5307
|
+
language?: string;
|
|
5308
|
+
durationInSeconds?: number;
|
|
5309
|
+
providerMetadata?: Record<string, JSONObject>;
|
|
5310
|
+
} | {
|
|
5311
|
+
/**
|
|
5312
|
+
* Raw provider chunks if enabled.
|
|
5313
|
+
*/
|
|
5314
|
+
type: 'raw';
|
|
5315
|
+
rawValue: unknown;
|
|
5316
|
+
} | {
|
|
5317
|
+
/**
|
|
5318
|
+
* Error parts are streamed, allowing for multiple errors.
|
|
5319
|
+
*/
|
|
5320
|
+
type: 'error';
|
|
5321
|
+
error: unknown;
|
|
5322
|
+
};
|
|
5323
|
+
|
|
5324
|
+
/**
|
|
5325
|
+
* The result of a transcription model doStream call.
|
|
5326
|
+
*/
|
|
5327
|
+
type TranscriptionModelV4StreamResult = {
|
|
5328
|
+
/**
|
|
5329
|
+
* The stream.
|
|
5330
|
+
*/
|
|
5331
|
+
stream: ReadableStream<TranscriptionModelV4StreamPart>;
|
|
5332
|
+
/**
|
|
5333
|
+
* Optional request information for telemetry and debugging purposes.
|
|
5334
|
+
*/
|
|
5335
|
+
request?: {
|
|
5336
|
+
/**
|
|
5337
|
+
* Request body or setup payload that was sent to the provider API.
|
|
5338
|
+
*/
|
|
5339
|
+
body?: unknown;
|
|
5340
|
+
};
|
|
5341
|
+
/**
|
|
5342
|
+
* Optional response data.
|
|
5343
|
+
*/
|
|
5344
|
+
response?: {
|
|
5345
|
+
/**
|
|
5346
|
+
* Timestamp for the start of the streamed response.
|
|
5347
|
+
*/
|
|
5348
|
+
timestamp?: Date;
|
|
5349
|
+
/**
|
|
5350
|
+
* The ID of the response model that was used to generate the response.
|
|
5351
|
+
*/
|
|
5352
|
+
modelId?: string;
|
|
5353
|
+
/**
|
|
5354
|
+
* Response headers.
|
|
5355
|
+
*/
|
|
5356
|
+
headers?: SharedV4Headers;
|
|
5357
|
+
/**
|
|
5358
|
+
* Response body.
|
|
5359
|
+
*/
|
|
5360
|
+
body?: unknown;
|
|
5361
|
+
};
|
|
5362
|
+
};
|
|
5363
|
+
|
|
5207
5364
|
/**
|
|
5208
5365
|
* Transcription model specification version 3.
|
|
5209
5366
|
*/
|
|
@@ -5228,6 +5385,15 @@ type TranscriptionModelV4 = {
|
|
|
5228
5385
|
* Generates a transcript.
|
|
5229
5386
|
*/
|
|
5230
5387
|
doGenerate(options: TranscriptionModelV4CallOptions): PromiseLike<TranscriptionModelV4Result>;
|
|
5388
|
+
/**
|
|
5389
|
+
* Streams a transcript for live audio.
|
|
5390
|
+
*
|
|
5391
|
+
* Experimental: the streaming transcription contract may change in patch
|
|
5392
|
+
* releases while `experimental_streamTranscribe` is experimental. The
|
|
5393
|
+
* stream option/part/result types are exported with `Experimental_`
|
|
5394
|
+
* prefixes for this reason.
|
|
5395
|
+
*/
|
|
5396
|
+
doStream?(options: TranscriptionModelV4StreamOptions): PromiseLike<TranscriptionModelV4StreamResult>;
|
|
5231
5397
|
};
|
|
5232
5398
|
|
|
5233
5399
|
interface SkillsV4File {
|
|
@@ -7205,4 +7371,4 @@ type VideoModelV3 = {
|
|
|
7205
7371
|
}>;
|
|
7206
7372
|
};
|
|
7207
7373
|
|
|
7208
|
-
export { AISDKError, APICallError, type EmbeddingModelV2, type EmbeddingModelV2Embedding, type EmbeddingModelV3, type EmbeddingModelV3CallOptions, type EmbeddingModelV3Embedding, type EmbeddingModelV3Middleware, type EmbeddingModelV3Result, type EmbeddingModelV4, type EmbeddingModelV4CallOptions, type EmbeddingModelV4Embedding, type EmbeddingModelV4Middleware, type EmbeddingModelV4Result, EmptyResponseBodyError, type RealtimeFactoryV4 as Experimental_RealtimeFactoryV4, type RealtimeFactoryV4GetTokenOptions as Experimental_RealtimeFactoryV4GetTokenOptions, type RealtimeFactoryV4GetTokenResult as Experimental_RealtimeFactoryV4GetTokenResult, type RealtimeModelV4 as Experimental_RealtimeModelV4, type RealtimeModelV4AudioMessage as Experimental_RealtimeModelV4AudioMessage, type RealtimeModelV4ClientEvent as Experimental_RealtimeModelV4ClientEvent, type RealtimeModelV4ClientSecretOptions as Experimental_RealtimeModelV4ClientSecretOptions, type RealtimeModelV4ClientSecretResult as Experimental_RealtimeModelV4ClientSecretResult, type RealtimeModelV4ConversationItem as Experimental_RealtimeModelV4ConversationItem, type RealtimeModelV4FunctionCallOutput as Experimental_RealtimeModelV4FunctionCallOutput, type RealtimeModelV4ServerEvent as Experimental_RealtimeModelV4ServerEvent, type RealtimeModelV4SessionConfig as Experimental_RealtimeModelV4SessionConfig, type RealtimeModelV4TextMessage as Experimental_RealtimeModelV4TextMessage, type RealtimeModelV4ToolDefinition as Experimental_RealtimeModelV4ToolDefinition, type VideoModelV3 as Experimental_VideoModelV3, type VideoModelV3CallOptions as Experimental_VideoModelV3CallOptions, type VideoModelV3File as Experimental_VideoModelV3File, type VideoModelV3FrameImage as Experimental_VideoModelV3FrameImage, type VideoModelV3FrameType as Experimental_VideoModelV3FrameType, type VideoModelV3VideoData as Experimental_VideoModelV3VideoData, type VideoModelV4 as Experimental_VideoModelV4, type VideoModelV4CallOptions as Experimental_VideoModelV4CallOptions, type VideoModelV4File as Experimental_VideoModelV4File, type VideoModelV4FrameImage as Experimental_VideoModelV4FrameImage, type VideoModelV4FrameType as Experimental_VideoModelV4FrameType, type VideoModelV4Result as Experimental_VideoModelV4Result, type VideoModelV4VideoData as Experimental_VideoModelV4VideoData, type FilesV4, type FilesV4UploadFileCallOptions, type FilesV4UploadFileResult, type ImageModelV2, type ImageModelV2CallOptions, type ImageModelV2CallWarning, type ImageModelV2ProviderMetadata, type ImageModelV3, type ImageModelV3CallOptions, type ImageModelV3File, type ImageModelV3Middleware, type ImageModelV3ProviderMetadata, type ImageModelV3Usage, type ImageModelV4, type ImageModelV4CallOptions, type ImageModelV4File, type ImageModelV4Middleware, type ImageModelV4ProviderMetadata, type ImageModelV4Result, type ImageModelV4Usage, InvalidArgumentError, InvalidPromptError, InvalidResponseDataError, type JSONArray, type JSONObject, JSONParseError, type JSONValue, type LanguageModelV2, type LanguageModelV2CallOptions, type LanguageModelV2CallWarning, type LanguageModelV2Content, type LanguageModelV2DataContent, type LanguageModelV2File, type LanguageModelV2FilePart, type LanguageModelV2FinishReason, type LanguageModelV2FunctionTool, type LanguageModelV2Message, type LanguageModelV2Middleware, type LanguageModelV2Prompt, type LanguageModelV2ProviderDefinedTool, type LanguageModelV2Reasoning, type LanguageModelV2ReasoningPart, type LanguageModelV2ResponseMetadata, type LanguageModelV2Source, type LanguageModelV2StreamPart, type LanguageModelV2Text, type LanguageModelV2TextPart, type LanguageModelV2ToolCall, type LanguageModelV2ToolCallPart, type LanguageModelV2ToolChoice, type LanguageModelV2ToolResultOutput, type LanguageModelV2ToolResultPart, type LanguageModelV2Usage, type LanguageModelV3, type LanguageModelV3CallOptions, type LanguageModelV3Content, type LanguageModelV3DataContent, type LanguageModelV3File, type LanguageModelV3FilePart, type LanguageModelV3FinishReason, type LanguageModelV3FunctionTool, type LanguageModelV3GenerateResult, type LanguageModelV3Message, type LanguageModelV3Middleware, type LanguageModelV3Prompt, type LanguageModelV3ProviderTool, type LanguageModelV3Reasoning, type LanguageModelV3ReasoningPart, type LanguageModelV3ResponseMetadata, type LanguageModelV3Source, type LanguageModelV3StreamPart, type LanguageModelV3StreamResult, type LanguageModelV3Text, type LanguageModelV3TextPart, type LanguageModelV3ToolApprovalRequest, type LanguageModelV3ToolApprovalResponsePart, type LanguageModelV3ToolCall, type LanguageModelV3ToolCallPart, type LanguageModelV3ToolChoice, type LanguageModelV3ToolResult, type LanguageModelV3ToolResultOutput, type LanguageModelV3ToolResultPart, type LanguageModelV3Usage, type LanguageModelV4, type LanguageModelV4CallOptions, type LanguageModelV4Content, type LanguageModelV4CustomContent, type LanguageModelV4CustomPart, type LanguageModelV4File, type LanguageModelV4FilePart, type LanguageModelV4FinishReason, type LanguageModelV4FunctionTool, type LanguageModelV4GenerateResult, type LanguageModelV4Message, type LanguageModelV4Middleware, type LanguageModelV4Prompt, type LanguageModelV4ProviderTool, type LanguageModelV4Reasoning, type LanguageModelV4ReasoningFile, type LanguageModelV4ReasoningFilePart, type LanguageModelV4ReasoningPart, type LanguageModelV4ResponseMetadata, type LanguageModelV4Source, type LanguageModelV4StreamPart, type LanguageModelV4StreamResult, type LanguageModelV4Text, type LanguageModelV4TextPart, type LanguageModelV4ToolApprovalRequest, type LanguageModelV4ToolApprovalResponsePart, type LanguageModelV4ToolCall, type LanguageModelV4ToolCallPart, type LanguageModelV4ToolChoice, type LanguageModelV4ToolResult, type LanguageModelV4ToolResultOutput, type LanguageModelV4ToolResultPart, type LanguageModelV4Usage, LoadAPIKeyError, LoadSettingError, NoContentGeneratedError, NoSuchModelError, NoSuchProviderReferenceError, type ProviderV2, type ProviderV3, type ProviderV4, type RerankingModelV3, type RerankingModelV3CallOptions, type RerankingModelV4, type RerankingModelV4CallOptions, type RerankingModelV4Result, type SharedV2Headers, type SharedV2ProviderMetadata, type SharedV2ProviderOptions, type SharedV3Headers, type SharedV3ProviderMetadata, type SharedV3ProviderOptions, type SharedV3Warning, type SharedV4FileData, type SharedV4FileDataData, type SharedV4FileDataReference, type SharedV4FileDataText, type SharedV4FileDataUrl, type SharedV4Headers, type SharedV4ProviderMetadata, type SharedV4ProviderOptions, type SharedV4ProviderReference, type SharedV4Warning, type SkillsV4, type SkillsV4File, type SkillsV4UploadSkillCallOptions, type SkillsV4UploadSkillResult, type SpeechModelV2, type SpeechModelV2CallOptions, type SpeechModelV2CallWarning, type SpeechModelV3, type SpeechModelV3CallOptions, type SpeechModelV4, type SpeechModelV4CallOptions, type SpeechModelV4Result, TooManyEmbeddingValuesForCallError, type TranscriptionModelV2, type TranscriptionModelV2CallOptions, type TranscriptionModelV2CallWarning, type TranscriptionModelV3, type TranscriptionModelV3CallOptions, type TranscriptionModelV4, type TranscriptionModelV4CallOptions, type TranscriptionModelV4Result, type TypeValidationContext, TypeValidationError, UnsupportedFunctionalityError, getErrorMessage, isJSONArray, isJSONObject, isJSONValue };
|
|
7374
|
+
export { AISDKError, APICallError, type EmbeddingModelV2, type EmbeddingModelV2Embedding, type EmbeddingModelV3, type EmbeddingModelV3CallOptions, type EmbeddingModelV3Embedding, type EmbeddingModelV3Middleware, type EmbeddingModelV3Result, type EmbeddingModelV4, type EmbeddingModelV4CallOptions, type EmbeddingModelV4Embedding, type EmbeddingModelV4Middleware, type EmbeddingModelV4Result, EmptyResponseBodyError, type RealtimeFactoryV4 as Experimental_RealtimeFactoryV4, type RealtimeFactoryV4GetTokenOptions as Experimental_RealtimeFactoryV4GetTokenOptions, type RealtimeFactoryV4GetTokenResult as Experimental_RealtimeFactoryV4GetTokenResult, type RealtimeModelV4 as Experimental_RealtimeModelV4, type RealtimeModelV4AudioMessage as Experimental_RealtimeModelV4AudioMessage, type RealtimeModelV4ClientEvent as Experimental_RealtimeModelV4ClientEvent, type RealtimeModelV4ClientSecretOptions as Experimental_RealtimeModelV4ClientSecretOptions, type RealtimeModelV4ClientSecretResult as Experimental_RealtimeModelV4ClientSecretResult, type RealtimeModelV4ConversationItem as Experimental_RealtimeModelV4ConversationItem, type RealtimeModelV4FunctionCallOutput as Experimental_RealtimeModelV4FunctionCallOutput, type RealtimeModelV4ServerEvent as Experimental_RealtimeModelV4ServerEvent, type RealtimeModelV4SessionConfig as Experimental_RealtimeModelV4SessionConfig, type RealtimeModelV4TextMessage as Experimental_RealtimeModelV4TextMessage, type RealtimeModelV4ToolDefinition as Experimental_RealtimeModelV4ToolDefinition, type TranscriptionModelV4StreamOptions as Experimental_TranscriptionModelV4StreamOptions, type TranscriptionModelV4StreamPart as Experimental_TranscriptionModelV4StreamPart, type TranscriptionModelV4StreamResult as Experimental_TranscriptionModelV4StreamResult, type VideoModelV3 as Experimental_VideoModelV3, type VideoModelV3CallOptions as Experimental_VideoModelV3CallOptions, type VideoModelV3File as Experimental_VideoModelV3File, type VideoModelV3FrameImage as Experimental_VideoModelV3FrameImage, type VideoModelV3FrameType as Experimental_VideoModelV3FrameType, type VideoModelV3VideoData as Experimental_VideoModelV3VideoData, type VideoModelV4 as Experimental_VideoModelV4, type VideoModelV4CallOptions as Experimental_VideoModelV4CallOptions, type VideoModelV4File as Experimental_VideoModelV4File, type VideoModelV4FrameImage as Experimental_VideoModelV4FrameImage, type VideoModelV4FrameType as Experimental_VideoModelV4FrameType, type VideoModelV4Result as Experimental_VideoModelV4Result, type VideoModelV4VideoData as Experimental_VideoModelV4VideoData, type FilesV4, type FilesV4UploadFileCallOptions, type FilesV4UploadFileResult, type ImageModelV2, type ImageModelV2CallOptions, type ImageModelV2CallWarning, type ImageModelV2ProviderMetadata, type ImageModelV3, type ImageModelV3CallOptions, type ImageModelV3File, type ImageModelV3Middleware, type ImageModelV3ProviderMetadata, type ImageModelV3Usage, type ImageModelV4, type ImageModelV4CallOptions, type ImageModelV4File, type ImageModelV4Middleware, type ImageModelV4ProviderMetadata, type ImageModelV4Result, type ImageModelV4Usage, InvalidArgumentError, InvalidPromptError, InvalidResponseDataError, type JSONArray, type JSONObject, JSONParseError, type JSONValue, type LanguageModelV2, type LanguageModelV2CallOptions, type LanguageModelV2CallWarning, type LanguageModelV2Content, type LanguageModelV2DataContent, type LanguageModelV2File, type LanguageModelV2FilePart, type LanguageModelV2FinishReason, type LanguageModelV2FunctionTool, type LanguageModelV2Message, type LanguageModelV2Middleware, type LanguageModelV2Prompt, type LanguageModelV2ProviderDefinedTool, type LanguageModelV2Reasoning, type LanguageModelV2ReasoningPart, type LanguageModelV2ResponseMetadata, type LanguageModelV2Source, type LanguageModelV2StreamPart, type LanguageModelV2Text, type LanguageModelV2TextPart, type LanguageModelV2ToolCall, type LanguageModelV2ToolCallPart, type LanguageModelV2ToolChoice, type LanguageModelV2ToolResultOutput, type LanguageModelV2ToolResultPart, type LanguageModelV2Usage, type LanguageModelV3, type LanguageModelV3CallOptions, type LanguageModelV3Content, type LanguageModelV3DataContent, type LanguageModelV3File, type LanguageModelV3FilePart, type LanguageModelV3FinishReason, type LanguageModelV3FunctionTool, type LanguageModelV3GenerateResult, type LanguageModelV3Message, type LanguageModelV3Middleware, type LanguageModelV3Prompt, type LanguageModelV3ProviderTool, type LanguageModelV3Reasoning, type LanguageModelV3ReasoningPart, type LanguageModelV3ResponseMetadata, type LanguageModelV3Source, type LanguageModelV3StreamPart, type LanguageModelV3StreamResult, type LanguageModelV3Text, type LanguageModelV3TextPart, type LanguageModelV3ToolApprovalRequest, type LanguageModelV3ToolApprovalResponsePart, type LanguageModelV3ToolCall, type LanguageModelV3ToolCallPart, type LanguageModelV3ToolChoice, type LanguageModelV3ToolResult, type LanguageModelV3ToolResultOutput, type LanguageModelV3ToolResultPart, type LanguageModelV3Usage, type LanguageModelV4, type LanguageModelV4CallOptions, type LanguageModelV4Content, type LanguageModelV4CustomContent, type LanguageModelV4CustomPart, type LanguageModelV4File, type LanguageModelV4FilePart, type LanguageModelV4FinishReason, type LanguageModelV4FunctionTool, type LanguageModelV4GenerateResult, type LanguageModelV4Message, type LanguageModelV4Middleware, type LanguageModelV4Prompt, type LanguageModelV4ProviderTool, type LanguageModelV4Reasoning, type LanguageModelV4ReasoningFile, type LanguageModelV4ReasoningFilePart, type LanguageModelV4ReasoningPart, type LanguageModelV4ResponseMetadata, type LanguageModelV4Source, type LanguageModelV4StreamPart, type LanguageModelV4StreamResult, type LanguageModelV4Text, type LanguageModelV4TextPart, type LanguageModelV4ToolApprovalRequest, type LanguageModelV4ToolApprovalResponsePart, type LanguageModelV4ToolCall, type LanguageModelV4ToolCallPart, type LanguageModelV4ToolChoice, type LanguageModelV4ToolResult, type LanguageModelV4ToolResultOutput, type LanguageModelV4ToolResultPart, type LanguageModelV4Usage, LoadAPIKeyError, LoadSettingError, NoContentGeneratedError, NoSuchModelError, NoSuchProviderReferenceError, type ProviderV2, type ProviderV3, type ProviderV4, type RerankingModelV3, type RerankingModelV3CallOptions, type RerankingModelV4, type RerankingModelV4CallOptions, type RerankingModelV4Result, type SharedV2Headers, type SharedV2ProviderMetadata, type SharedV2ProviderOptions, type SharedV3Headers, type SharedV3ProviderMetadata, type SharedV3ProviderOptions, type SharedV3Warning, type SharedV4FileData, type SharedV4FileDataData, type SharedV4FileDataReference, type SharedV4FileDataText, type SharedV4FileDataUrl, type SharedV4Headers, type SharedV4ProviderMetadata, type SharedV4ProviderOptions, type SharedV4ProviderReference, type SharedV4Warning, type SkillsV4, type SkillsV4File, type SkillsV4UploadSkillCallOptions, type SkillsV4UploadSkillResult, type SpeechModelV2, type SpeechModelV2CallOptions, type SpeechModelV2CallWarning, type SpeechModelV3, type SpeechModelV3CallOptions, type SpeechModelV4, type SpeechModelV4CallOptions, type SpeechModelV4Result, TooManyEmbeddingValuesForCallError, type TranscriptionModelV2, type TranscriptionModelV2CallOptions, type TranscriptionModelV2CallWarning, type TranscriptionModelV3, type TranscriptionModelV3CallOptions, type TranscriptionModelV4, type TranscriptionModelV4CallOptions, type TranscriptionModelV4Result, type TypeValidationContext, TypeValidationError, UnsupportedFunctionalityError, getErrorMessage, isJSONArray, isJSONObject, isJSONValue };
|
package/package.json
CHANGED
|
@@ -1,3 +1,6 @@
|
|
|
1
1
|
export type { TranscriptionModelV4 } from './transcription-model-v4';
|
|
2
2
|
export type { TranscriptionModelV4CallOptions } from './transcription-model-v4-call-options';
|
|
3
3
|
export type { TranscriptionModelV4Result } from './transcription-model-v4-result';
|
|
4
|
+
export type { TranscriptionModelV4StreamOptions as Experimental_TranscriptionModelV4StreamOptions } from './transcription-model-v4-stream-options';
|
|
5
|
+
export type { TranscriptionModelV4StreamPart as Experimental_TranscriptionModelV4StreamPart } from './transcription-model-v4-stream-part';
|
|
6
|
+
export type { TranscriptionModelV4StreamResult as Experimental_TranscriptionModelV4StreamResult } from './transcription-model-v4-stream-result';
|
|
@@ -0,0 +1,52 @@
|
|
|
1
|
+
import type { JSONObject } from '../../json-value/json-value';
|
|
2
|
+
|
|
3
|
+
type TranscriptionModelV4ProviderOptions = Record<string, JSONObject>;
|
|
4
|
+
|
|
5
|
+
export type TranscriptionModelV4StreamOptions = {
|
|
6
|
+
/**
|
|
7
|
+
* Audio chunks to transcribe.
|
|
8
|
+
*
|
|
9
|
+
* `Uint8Array` chunks contain raw audio bytes. `string` chunks contain
|
|
10
|
+
* base64-encoded raw audio bytes.
|
|
11
|
+
*/
|
|
12
|
+
audio: ReadableStream<Uint8Array | string>;
|
|
13
|
+
|
|
14
|
+
/**
|
|
15
|
+
* The input audio format for the raw audio chunks.
|
|
16
|
+
*/
|
|
17
|
+
inputAudioFormat: {
|
|
18
|
+
/**
|
|
19
|
+
* Audio format type, e.g. `audio/pcm`, `audio/pcmu`, or `audio/pcma`.
|
|
20
|
+
*/
|
|
21
|
+
type: string;
|
|
22
|
+
|
|
23
|
+
/**
|
|
24
|
+
* Sample rate in Hz. Only applicable for formats that require a rate.
|
|
25
|
+
*/
|
|
26
|
+
rate?: number;
|
|
27
|
+
};
|
|
28
|
+
|
|
29
|
+
/**
|
|
30
|
+
* Additional provider-specific options that are passed through to the provider.
|
|
31
|
+
*
|
|
32
|
+
* The outer record is keyed by the provider name, and the inner record is keyed
|
|
33
|
+
* by provider-specific option names.
|
|
34
|
+
*/
|
|
35
|
+
providerOptions?: TranscriptionModelV4ProviderOptions;
|
|
36
|
+
|
|
37
|
+
/**
|
|
38
|
+
* Abort signal for cancelling the operation.
|
|
39
|
+
*/
|
|
40
|
+
abortSignal?: AbortSignal;
|
|
41
|
+
|
|
42
|
+
/**
|
|
43
|
+
* Additional HTTP headers to be sent with the request.
|
|
44
|
+
* Only applicable for HTTP/WebSocket-based providers that support headers.
|
|
45
|
+
*/
|
|
46
|
+
headers?: Record<string, string | undefined>;
|
|
47
|
+
|
|
48
|
+
/**
|
|
49
|
+
* When true, providers should include raw provider chunks in the stream.
|
|
50
|
+
*/
|
|
51
|
+
includeRawChunks?: boolean;
|
|
52
|
+
};
|
|
@@ -0,0 +1,85 @@
|
|
|
1
|
+
import type { JSONObject } from '../../json-value/json-value';
|
|
2
|
+
import type { SharedV4Headers } from '../../shared';
|
|
3
|
+
import type { SharedV4ProviderMetadata } from '../../shared/v4/shared-v4-provider-metadata';
|
|
4
|
+
import type { SharedV4Warning } from '../../shared/v4/shared-v4-warning';
|
|
5
|
+
|
|
6
|
+
export type TranscriptionModelV4StreamPart =
|
|
7
|
+
| {
|
|
8
|
+
/**
|
|
9
|
+
* Stream start event with warnings for the call, e.g. unsupported settings.
|
|
10
|
+
*/
|
|
11
|
+
type: 'stream-start';
|
|
12
|
+
warnings: Array<SharedV4Warning>;
|
|
13
|
+
}
|
|
14
|
+
| {
|
|
15
|
+
/**
|
|
16
|
+
* Append-only transcript delta.
|
|
17
|
+
*/
|
|
18
|
+
type: 'transcript-delta';
|
|
19
|
+
id?: string;
|
|
20
|
+
delta: string;
|
|
21
|
+
providerMetadata?: SharedV4ProviderMetadata;
|
|
22
|
+
}
|
|
23
|
+
| {
|
|
24
|
+
/**
|
|
25
|
+
* Non-final transcript text. The text may be revised by later parts.
|
|
26
|
+
*/
|
|
27
|
+
type: 'transcript-partial';
|
|
28
|
+
id?: string;
|
|
29
|
+
text: string;
|
|
30
|
+
startSecond?: number;
|
|
31
|
+
durationInSeconds?: number;
|
|
32
|
+
channelIndex?: number;
|
|
33
|
+
providerMetadata?: SharedV4ProviderMetadata;
|
|
34
|
+
}
|
|
35
|
+
| {
|
|
36
|
+
/**
|
|
37
|
+
* Final transcript text for a provider-defined segment or utterance.
|
|
38
|
+
*/
|
|
39
|
+
type: 'transcript-final';
|
|
40
|
+
id?: string;
|
|
41
|
+
text: string;
|
|
42
|
+
startSecond?: number;
|
|
43
|
+
endSecond?: number;
|
|
44
|
+
channelIndex?: number;
|
|
45
|
+
providerMetadata?: SharedV4ProviderMetadata;
|
|
46
|
+
}
|
|
47
|
+
| {
|
|
48
|
+
/**
|
|
49
|
+
* Metadata for the response, emitted once available.
|
|
50
|
+
*/
|
|
51
|
+
type: 'response-metadata';
|
|
52
|
+
timestamp?: Date;
|
|
53
|
+
modelId?: string;
|
|
54
|
+
headers?: SharedV4Headers;
|
|
55
|
+
body?: unknown;
|
|
56
|
+
}
|
|
57
|
+
| {
|
|
58
|
+
/**
|
|
59
|
+
* Metadata that is available after the stream is finished.
|
|
60
|
+
*/
|
|
61
|
+
type: 'finish';
|
|
62
|
+
text: string;
|
|
63
|
+
segments: Array<{
|
|
64
|
+
text: string;
|
|
65
|
+
startSecond: number;
|
|
66
|
+
endSecond: number;
|
|
67
|
+
}>;
|
|
68
|
+
language?: string;
|
|
69
|
+
durationInSeconds?: number;
|
|
70
|
+
providerMetadata?: Record<string, JSONObject>;
|
|
71
|
+
}
|
|
72
|
+
| {
|
|
73
|
+
/**
|
|
74
|
+
* Raw provider chunks if enabled.
|
|
75
|
+
*/
|
|
76
|
+
type: 'raw';
|
|
77
|
+
rawValue: unknown;
|
|
78
|
+
}
|
|
79
|
+
| {
|
|
80
|
+
/**
|
|
81
|
+
* Error parts are streamed, allowing for multiple errors.
|
|
82
|
+
*/
|
|
83
|
+
type: 'error';
|
|
84
|
+
error: unknown;
|
|
85
|
+
};
|
|
@@ -0,0 +1,47 @@
|
|
|
1
|
+
import type { SharedV4Headers } from '../../shared';
|
|
2
|
+
import type { TranscriptionModelV4StreamPart } from './transcription-model-v4-stream-part';
|
|
3
|
+
|
|
4
|
+
/**
|
|
5
|
+
* The result of a transcription model doStream call.
|
|
6
|
+
*/
|
|
7
|
+
export type TranscriptionModelV4StreamResult = {
|
|
8
|
+
/**
|
|
9
|
+
* The stream.
|
|
10
|
+
*/
|
|
11
|
+
stream: ReadableStream<TranscriptionModelV4StreamPart>;
|
|
12
|
+
|
|
13
|
+
/**
|
|
14
|
+
* Optional request information for telemetry and debugging purposes.
|
|
15
|
+
*/
|
|
16
|
+
request?: {
|
|
17
|
+
/**
|
|
18
|
+
* Request body or setup payload that was sent to the provider API.
|
|
19
|
+
*/
|
|
20
|
+
body?: unknown;
|
|
21
|
+
};
|
|
22
|
+
|
|
23
|
+
/**
|
|
24
|
+
* Optional response data.
|
|
25
|
+
*/
|
|
26
|
+
response?: {
|
|
27
|
+
/**
|
|
28
|
+
* Timestamp for the start of the streamed response.
|
|
29
|
+
*/
|
|
30
|
+
timestamp?: Date;
|
|
31
|
+
|
|
32
|
+
/**
|
|
33
|
+
* The ID of the response model that was used to generate the response.
|
|
34
|
+
*/
|
|
35
|
+
modelId?: string;
|
|
36
|
+
|
|
37
|
+
/**
|
|
38
|
+
* Response headers.
|
|
39
|
+
*/
|
|
40
|
+
headers?: SharedV4Headers;
|
|
41
|
+
|
|
42
|
+
/**
|
|
43
|
+
* Response body.
|
|
44
|
+
*/
|
|
45
|
+
body?: unknown;
|
|
46
|
+
};
|
|
47
|
+
};
|
|
@@ -1,5 +1,7 @@
|
|
|
1
1
|
import type { TranscriptionModelV4CallOptions } from './transcription-model-v4-call-options';
|
|
2
2
|
import type { TranscriptionModelV4Result } from './transcription-model-v4-result';
|
|
3
|
+
import type { TranscriptionModelV4StreamOptions } from './transcription-model-v4-stream-options';
|
|
4
|
+
import type { TranscriptionModelV4StreamResult } from './transcription-model-v4-stream-result';
|
|
3
5
|
|
|
4
6
|
/**
|
|
5
7
|
* Transcription model specification version 3.
|
|
@@ -30,4 +32,16 @@ export type TranscriptionModelV4 = {
|
|
|
30
32
|
doGenerate(
|
|
31
33
|
options: TranscriptionModelV4CallOptions,
|
|
32
34
|
): PromiseLike<TranscriptionModelV4Result>;
|
|
35
|
+
|
|
36
|
+
/**
|
|
37
|
+
* Streams a transcript for live audio.
|
|
38
|
+
*
|
|
39
|
+
* Experimental: the streaming transcription contract may change in patch
|
|
40
|
+
* releases while `experimental_streamTranscribe` is experimental. The
|
|
41
|
+
* stream option/part/result types are exported with `Experimental_`
|
|
42
|
+
* prefixes for this reason.
|
|
43
|
+
*/
|
|
44
|
+
doStream?(
|
|
45
|
+
options: TranscriptionModelV4StreamOptions,
|
|
46
|
+
): PromiseLike<TranscriptionModelV4StreamResult>;
|
|
33
47
|
};
|