@ai-sdk/provider 4.0.0-canary.18 → 4.0.1

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
package/CHANGELOG.md CHANGED
@@ -1,5 +1,65 @@
1
1
  # @ai-sdk/provider
2
2
 
3
+ ## 4.0.1
4
+
5
+ ### Patch Changes
6
+
7
+ - 0274f34: feat (video): add first-class `frameImages` and `inputReferences` call options for video generation
8
+
9
+ ## 4.0.0
10
+
11
+ ### Major Changes
12
+
13
+ - f7d4f01: feat(provider): add support for `reasoning-file` type for files that are part of reasoning
14
+ - 776b617: feat(provider): adding new 'custom' content type
15
+ - 34bd95d: feat(ai): add support for uploading provider skills using the provider references abstraction
16
+ - ef992f8: Remove CommonJS exports from all packages. All packages are now ESM-only (`"type": "module"`). Consumers using `require()` must switch to ESM `import` syntax.
17
+ - c29a26f: feat(provider): add support for provider references and uploading files as supported per provider
18
+ - 3887c70: feat(provider): add new top-level reasoning parameter to spec and support it in `generateText` and `streamText`
19
+ - 9bd6512: feat(provider): change file part data property to be tagged with a type and remove the image part type
20
+ - 8359612: Start v7 pre-release
21
+ - 5463d0d: feat(provider): align tool result output content file part types with top-level message file part types
22
+
23
+ ### Patch Changes
24
+
25
+ - 1f509d4: fix(ai): force template check on 'kind' param
26
+ - 176466a: chore(provider): align V4 model return types to have their own definitions across all model interfaces
27
+ - 5c2a5a2: fix(provider): fix v4 spec to not use shared v3 types
28
+ - 9f0e36c: trigger release for all packages after provenance setup
29
+ - 008271d: feat(openai-compatible): emit warning when using kebab-case instead of camelCase
30
+ - 7fc6bd6: Raise minimum supported Node.js version to 22. Supported versions: 22, 24, and 26.
31
+ - 0c4c275: trigger initial canary release
32
+ - 6fd51c0: fix(provider): preserve error type prefix in getErrorMessage
33
+ - ce769dd: feat(provider): add experimental Realtime API support for voice conversations
34
+
35
+ Adds first-class support for realtime (speech-to-speech) APIs:
36
+
37
+ - `Experimental_RealtimeModelV4` spec in `@ai-sdk/provider` with normalized event types and factory
38
+ - OpenAI, Google, and xAI realtime provider implementations
39
+ - `openai.experimental_realtime()` / `google.experimental_realtime()` / `xai.experimental_realtime()` work in both server and browser
40
+ - `.getToken()` static method on each provider for server-side ephemeral token creation
41
+ - `experimental_getRealtimeToolDefinitions` helper for provider session tool definitions
42
+ - `experimental_useRealtime` hook in `@ai-sdk/react` returning `UIMessage[]` (aligned with `useChat`), with `onToolCall` and `addToolOutput` for client-driven tool execution
43
+ - `inputAudioTranscription` session config for showing transcribed user audio messages when supported by the provider
44
+
45
+ - e311194: feat(ai): allow passing provider instance to `uploadFile` and `uploadSkill` as shorthand
46
+ - 258c093: chore: ensure consistent import handling and avoid import duplicates or cycles
47
+ - b8396f0: trigger initial beta release
48
+ - 0416e3e: feat (video): add first-class `generateAudio` call option
49
+ - ff5eba1: feat: roll `image-*` tool output types into their equivalent `file-*` types
50
+
51
+ ## 4.0.0-beta.20
52
+
53
+ ### Patch Changes
54
+
55
+ - 0416e3e: feat (video): add first-class `generateAudio` call option
56
+
57
+ ## 4.0.0-beta.19
58
+
59
+ ### Patch Changes
60
+
61
+ - b8396f0: trigger initial beta release
62
+
3
63
  ## 4.0.0-canary.18
4
64
 
5
65
  ### Patch Changes
package/dist/index.d.ts CHANGED
@@ -6730,6 +6730,27 @@ type VideoModelV4File = {
6730
6730
  providerOptions?: SharedV4ProviderMetadata;
6731
6731
  };
6732
6732
 
6733
+ /**
6734
+ * The role a frame image plays in video generation.
6735
+ *
6736
+ * - `first_frame`: the starting frame the model animates from
6737
+ * - `last_frame`: the ending frame the model animates towards
6738
+ */
6739
+ type VideoModelV4FrameType = 'first_frame' | 'last_frame';
6740
+ /**
6741
+ * A role-tagged image input for image-to-video and first-last-frame generation.
6742
+ */
6743
+ type VideoModelV4FrameImage = {
6744
+ /**
6745
+ * The image file used for this frame.
6746
+ */
6747
+ image: VideoModelV4File;
6748
+ /**
6749
+ * Which frame this image represents.
6750
+ */
6751
+ frameType: VideoModelV4FrameType;
6752
+ };
6753
+
6733
6754
  type VideoModelV4CallOptions = {
6734
6755
  /**
6735
6756
  * Text prompt for the video generation.
@@ -6775,6 +6796,20 @@ type VideoModelV4CallOptions = {
6775
6796
  * The image serves as the starting frame that the model will animate.
6776
6797
  */
6777
6798
  image: VideoModelV4File | undefined;
6799
+ /**
6800
+ * Role-tagged image inputs for first-last-frame generation.
6801
+ * Each entry declares whether it is the `first_frame` or the
6802
+ * `last_frame` of the generated video.
6803
+ */
6804
+ frameImages: Array<VideoModelV4FrameImage> | undefined;
6805
+ /**
6806
+ * Reference image inputs for reference-to-video generation.
6807
+ */
6808
+ inputReferences: Array<VideoModelV4File> | undefined;
6809
+ /**
6810
+ * Whether the model should generate audio alongside the video.
6811
+ */
6812
+ generateAudio: boolean | undefined;
6778
6813
  /**
6779
6814
  * Additional provider-specific options that are passed through to the provider
6780
6815
  * as body parameters.
@@ -6951,6 +6986,27 @@ type VideoModelV3File = {
6951
6986
  providerOptions?: SharedV3ProviderMetadata;
6952
6987
  };
6953
6988
 
6989
+ /**
6990
+ * The role a frame image plays in video generation.
6991
+ *
6992
+ * - `first_frame`: the starting frame the model animates from
6993
+ * - `last_frame`: the ending frame the model animates towards
6994
+ */
6995
+ type VideoModelV3FrameType = 'first_frame' | 'last_frame';
6996
+ /**
6997
+ * A role-tagged image input for image-to-video and first-last-frame generation.
6998
+ */
6999
+ type VideoModelV3FrameImage = {
7000
+ /**
7001
+ * The image file used for this frame.
7002
+ */
7003
+ image: VideoModelV3File;
7004
+ /**
7005
+ * Which frame this image represents.
7006
+ */
7007
+ frameType: VideoModelV3FrameType;
7008
+ };
7009
+
6954
7010
  type VideoModelV3CallOptions = {
6955
7011
  /**
6956
7012
  * Text prompt for the video generation.
@@ -6996,6 +7052,20 @@ type VideoModelV3CallOptions = {
6996
7052
  * The image serves as the starting frame that the model will animate.
6997
7053
  */
6998
7054
  image: VideoModelV3File | undefined;
7055
+ /**
7056
+ * Role-tagged image inputs for first-last-frame generation.
7057
+ * Each entry declares whether it is the `first_frame` or the
7058
+ * `last_frame` of the generated video.
7059
+ */
7060
+ frameImages: Array<VideoModelV3FrameImage> | undefined;
7061
+ /**
7062
+ * Reference image inputs for reference-to-video generation.
7063
+ */
7064
+ inputReferences: Array<VideoModelV3File> | undefined;
7065
+ /**
7066
+ * Whether the model should generate audio alongside the video.
7067
+ */
7068
+ generateAudio: boolean | undefined;
6999
7069
  /**
7000
7070
  * Additional provider-specific options that are passed through to the provider
7001
7071
  * as body parameters.
@@ -7135,4 +7205,4 @@ type VideoModelV3 = {
7135
7205
  }>;
7136
7206
  };
7137
7207
 
7138
- export { AISDKError, APICallError, type EmbeddingModelV2, type EmbeddingModelV2Embedding, type EmbeddingModelV3, type EmbeddingModelV3CallOptions, type EmbeddingModelV3Embedding, type EmbeddingModelV3Middleware, type EmbeddingModelV3Result, type EmbeddingModelV4, type EmbeddingModelV4CallOptions, type EmbeddingModelV4Embedding, type EmbeddingModelV4Middleware, type EmbeddingModelV4Result, EmptyResponseBodyError, type RealtimeFactoryV4 as Experimental_RealtimeFactoryV4, type RealtimeFactoryV4GetTokenOptions as Experimental_RealtimeFactoryV4GetTokenOptions, type RealtimeFactoryV4GetTokenResult as Experimental_RealtimeFactoryV4GetTokenResult, type RealtimeModelV4 as Experimental_RealtimeModelV4, type RealtimeModelV4AudioMessage as Experimental_RealtimeModelV4AudioMessage, type RealtimeModelV4ClientEvent as Experimental_RealtimeModelV4ClientEvent, type RealtimeModelV4ClientSecretOptions as Experimental_RealtimeModelV4ClientSecretOptions, type RealtimeModelV4ClientSecretResult as Experimental_RealtimeModelV4ClientSecretResult, type RealtimeModelV4ConversationItem as Experimental_RealtimeModelV4ConversationItem, type RealtimeModelV4FunctionCallOutput as Experimental_RealtimeModelV4FunctionCallOutput, type RealtimeModelV4ServerEvent as Experimental_RealtimeModelV4ServerEvent, type RealtimeModelV4SessionConfig as Experimental_RealtimeModelV4SessionConfig, type RealtimeModelV4TextMessage as Experimental_RealtimeModelV4TextMessage, type RealtimeModelV4ToolDefinition as Experimental_RealtimeModelV4ToolDefinition, type VideoModelV3 as Experimental_VideoModelV3, type VideoModelV3CallOptions as Experimental_VideoModelV3CallOptions, type VideoModelV3File as Experimental_VideoModelV3File, type VideoModelV3VideoData as Experimental_VideoModelV3VideoData, type VideoModelV4 as Experimental_VideoModelV4, type VideoModelV4CallOptions as Experimental_VideoModelV4CallOptions, type VideoModelV4File as Experimental_VideoModelV4File, type VideoModelV4Result as Experimental_VideoModelV4Result, type VideoModelV4VideoData as Experimental_VideoModelV4VideoData, type FilesV4, type FilesV4UploadFileCallOptions, type FilesV4UploadFileResult, type ImageModelV2, type ImageModelV2CallOptions, type ImageModelV2CallWarning, type ImageModelV2ProviderMetadata, type ImageModelV3, type ImageModelV3CallOptions, type ImageModelV3File, type ImageModelV3Middleware, type ImageModelV3ProviderMetadata, type ImageModelV3Usage, type ImageModelV4, type ImageModelV4CallOptions, type ImageModelV4File, type ImageModelV4Middleware, type ImageModelV4ProviderMetadata, type ImageModelV4Result, type ImageModelV4Usage, InvalidArgumentError, InvalidPromptError, InvalidResponseDataError, type JSONArray, type JSONObject, JSONParseError, type JSONValue, type LanguageModelV2, type LanguageModelV2CallOptions, type LanguageModelV2CallWarning, type LanguageModelV2Content, type LanguageModelV2DataContent, type LanguageModelV2File, type LanguageModelV2FilePart, type LanguageModelV2FinishReason, type LanguageModelV2FunctionTool, type LanguageModelV2Message, type LanguageModelV2Middleware, type LanguageModelV2Prompt, type LanguageModelV2ProviderDefinedTool, type LanguageModelV2Reasoning, type LanguageModelV2ReasoningPart, type LanguageModelV2ResponseMetadata, type LanguageModelV2Source, type LanguageModelV2StreamPart, type LanguageModelV2Text, type LanguageModelV2TextPart, type LanguageModelV2ToolCall, type LanguageModelV2ToolCallPart, type LanguageModelV2ToolChoice, type LanguageModelV2ToolResultOutput, type LanguageModelV2ToolResultPart, type LanguageModelV2Usage, type LanguageModelV3, type LanguageModelV3CallOptions, type LanguageModelV3Content, type LanguageModelV3DataContent, type LanguageModelV3File, type LanguageModelV3FilePart, type LanguageModelV3FinishReason, type LanguageModelV3FunctionTool, type LanguageModelV3GenerateResult, type LanguageModelV3Message, type LanguageModelV3Middleware, type LanguageModelV3Prompt, type LanguageModelV3ProviderTool, type LanguageModelV3Reasoning, type LanguageModelV3ReasoningPart, type LanguageModelV3ResponseMetadata, type LanguageModelV3Source, type LanguageModelV3StreamPart, type LanguageModelV3StreamResult, type LanguageModelV3Text, type LanguageModelV3TextPart, type LanguageModelV3ToolApprovalRequest, type LanguageModelV3ToolApprovalResponsePart, type LanguageModelV3ToolCall, type LanguageModelV3ToolCallPart, type LanguageModelV3ToolChoice, type LanguageModelV3ToolResult, type LanguageModelV3ToolResultOutput, type LanguageModelV3ToolResultPart, type LanguageModelV3Usage, type LanguageModelV4, type LanguageModelV4CallOptions, type LanguageModelV4Content, type LanguageModelV4CustomContent, type LanguageModelV4CustomPart, type LanguageModelV4File, type LanguageModelV4FilePart, type LanguageModelV4FinishReason, type LanguageModelV4FunctionTool, type LanguageModelV4GenerateResult, type LanguageModelV4Message, type LanguageModelV4Middleware, type LanguageModelV4Prompt, type LanguageModelV4ProviderTool, type LanguageModelV4Reasoning, type LanguageModelV4ReasoningFile, type LanguageModelV4ReasoningFilePart, type LanguageModelV4ReasoningPart, type LanguageModelV4ResponseMetadata, type LanguageModelV4Source, type LanguageModelV4StreamPart, type LanguageModelV4StreamResult, type LanguageModelV4Text, type LanguageModelV4TextPart, type LanguageModelV4ToolApprovalRequest, type LanguageModelV4ToolApprovalResponsePart, type LanguageModelV4ToolCall, type LanguageModelV4ToolCallPart, type LanguageModelV4ToolChoice, type LanguageModelV4ToolResult, type LanguageModelV4ToolResultOutput, type LanguageModelV4ToolResultPart, type LanguageModelV4Usage, LoadAPIKeyError, LoadSettingError, NoContentGeneratedError, NoSuchModelError, NoSuchProviderReferenceError, type ProviderV2, type ProviderV3, type ProviderV4, type RerankingModelV3, type RerankingModelV3CallOptions, type RerankingModelV4, type RerankingModelV4CallOptions, type RerankingModelV4Result, type SharedV2Headers, type SharedV2ProviderMetadata, type SharedV2ProviderOptions, type SharedV3Headers, type SharedV3ProviderMetadata, type SharedV3ProviderOptions, type SharedV3Warning, type SharedV4FileData, type SharedV4FileDataData, type SharedV4FileDataReference, type SharedV4FileDataText, type SharedV4FileDataUrl, type SharedV4Headers, type SharedV4ProviderMetadata, type SharedV4ProviderOptions, type SharedV4ProviderReference, type SharedV4Warning, type SkillsV4, type SkillsV4File, type SkillsV4UploadSkillCallOptions, type SkillsV4UploadSkillResult, type SpeechModelV2, type SpeechModelV2CallOptions, type SpeechModelV2CallWarning, type SpeechModelV3, type SpeechModelV3CallOptions, type SpeechModelV4, type SpeechModelV4CallOptions, type SpeechModelV4Result, TooManyEmbeddingValuesForCallError, type TranscriptionModelV2, type TranscriptionModelV2CallOptions, type TranscriptionModelV2CallWarning, type TranscriptionModelV3, type TranscriptionModelV3CallOptions, type TranscriptionModelV4, type TranscriptionModelV4CallOptions, type TranscriptionModelV4Result, type TypeValidationContext, TypeValidationError, UnsupportedFunctionalityError, getErrorMessage, isJSONArray, isJSONObject, isJSONValue };
7208
+ export { AISDKError, APICallError, type EmbeddingModelV2, type EmbeddingModelV2Embedding, type EmbeddingModelV3, type EmbeddingModelV3CallOptions, type EmbeddingModelV3Embedding, type EmbeddingModelV3Middleware, type EmbeddingModelV3Result, type EmbeddingModelV4, type EmbeddingModelV4CallOptions, type EmbeddingModelV4Embedding, type EmbeddingModelV4Middleware, type EmbeddingModelV4Result, EmptyResponseBodyError, type RealtimeFactoryV4 as Experimental_RealtimeFactoryV4, type RealtimeFactoryV4GetTokenOptions as Experimental_RealtimeFactoryV4GetTokenOptions, type RealtimeFactoryV4GetTokenResult as Experimental_RealtimeFactoryV4GetTokenResult, type RealtimeModelV4 as Experimental_RealtimeModelV4, type RealtimeModelV4AudioMessage as Experimental_RealtimeModelV4AudioMessage, type RealtimeModelV4ClientEvent as Experimental_RealtimeModelV4ClientEvent, type RealtimeModelV4ClientSecretOptions as Experimental_RealtimeModelV4ClientSecretOptions, type RealtimeModelV4ClientSecretResult as Experimental_RealtimeModelV4ClientSecretResult, type RealtimeModelV4ConversationItem as Experimental_RealtimeModelV4ConversationItem, type RealtimeModelV4FunctionCallOutput as Experimental_RealtimeModelV4FunctionCallOutput, type RealtimeModelV4ServerEvent as Experimental_RealtimeModelV4ServerEvent, type RealtimeModelV4SessionConfig as Experimental_RealtimeModelV4SessionConfig, type RealtimeModelV4TextMessage as Experimental_RealtimeModelV4TextMessage, type RealtimeModelV4ToolDefinition as Experimental_RealtimeModelV4ToolDefinition, type VideoModelV3 as Experimental_VideoModelV3, type VideoModelV3CallOptions as Experimental_VideoModelV3CallOptions, type VideoModelV3File as Experimental_VideoModelV3File, type VideoModelV3FrameImage as Experimental_VideoModelV3FrameImage, type VideoModelV3FrameType as Experimental_VideoModelV3FrameType, type VideoModelV3VideoData as Experimental_VideoModelV3VideoData, type VideoModelV4 as Experimental_VideoModelV4, type VideoModelV4CallOptions as Experimental_VideoModelV4CallOptions, type VideoModelV4File as Experimental_VideoModelV4File, type VideoModelV4FrameImage as Experimental_VideoModelV4FrameImage, type VideoModelV4FrameType as Experimental_VideoModelV4FrameType, type VideoModelV4Result as Experimental_VideoModelV4Result, type VideoModelV4VideoData as Experimental_VideoModelV4VideoData, type FilesV4, type FilesV4UploadFileCallOptions, type FilesV4UploadFileResult, type ImageModelV2, type ImageModelV2CallOptions, type ImageModelV2CallWarning, type ImageModelV2ProviderMetadata, type ImageModelV3, type ImageModelV3CallOptions, type ImageModelV3File, type ImageModelV3Middleware, type ImageModelV3ProviderMetadata, type ImageModelV3Usage, type ImageModelV4, type ImageModelV4CallOptions, type ImageModelV4File, type ImageModelV4Middleware, type ImageModelV4ProviderMetadata, type ImageModelV4Result, type ImageModelV4Usage, InvalidArgumentError, InvalidPromptError, InvalidResponseDataError, type JSONArray, type JSONObject, JSONParseError, type JSONValue, type LanguageModelV2, type LanguageModelV2CallOptions, type LanguageModelV2CallWarning, type LanguageModelV2Content, type LanguageModelV2DataContent, type LanguageModelV2File, type LanguageModelV2FilePart, type LanguageModelV2FinishReason, type LanguageModelV2FunctionTool, type LanguageModelV2Message, type LanguageModelV2Middleware, type LanguageModelV2Prompt, type LanguageModelV2ProviderDefinedTool, type LanguageModelV2Reasoning, type LanguageModelV2ReasoningPart, type LanguageModelV2ResponseMetadata, type LanguageModelV2Source, type LanguageModelV2StreamPart, type LanguageModelV2Text, type LanguageModelV2TextPart, type LanguageModelV2ToolCall, type LanguageModelV2ToolCallPart, type LanguageModelV2ToolChoice, type LanguageModelV2ToolResultOutput, type LanguageModelV2ToolResultPart, type LanguageModelV2Usage, type LanguageModelV3, type LanguageModelV3CallOptions, type LanguageModelV3Content, type LanguageModelV3DataContent, type LanguageModelV3File, type LanguageModelV3FilePart, type LanguageModelV3FinishReason, type LanguageModelV3FunctionTool, type LanguageModelV3GenerateResult, type LanguageModelV3Message, type LanguageModelV3Middleware, type LanguageModelV3Prompt, type LanguageModelV3ProviderTool, type LanguageModelV3Reasoning, type LanguageModelV3ReasoningPart, type LanguageModelV3ResponseMetadata, type LanguageModelV3Source, type LanguageModelV3StreamPart, type LanguageModelV3StreamResult, type LanguageModelV3Text, type LanguageModelV3TextPart, type LanguageModelV3ToolApprovalRequest, type LanguageModelV3ToolApprovalResponsePart, type LanguageModelV3ToolCall, type LanguageModelV3ToolCallPart, type LanguageModelV3ToolChoice, type LanguageModelV3ToolResult, type LanguageModelV3ToolResultOutput, type LanguageModelV3ToolResultPart, type LanguageModelV3Usage, type LanguageModelV4, type LanguageModelV4CallOptions, type LanguageModelV4Content, type LanguageModelV4CustomContent, type LanguageModelV4CustomPart, type LanguageModelV4File, type LanguageModelV4FilePart, type LanguageModelV4FinishReason, type LanguageModelV4FunctionTool, type LanguageModelV4GenerateResult, type LanguageModelV4Message, type LanguageModelV4Middleware, type LanguageModelV4Prompt, type LanguageModelV4ProviderTool, type LanguageModelV4Reasoning, type LanguageModelV4ReasoningFile, type LanguageModelV4ReasoningFilePart, type LanguageModelV4ReasoningPart, type LanguageModelV4ResponseMetadata, type LanguageModelV4Source, type LanguageModelV4StreamPart, type LanguageModelV4StreamResult, type LanguageModelV4Text, type LanguageModelV4TextPart, type LanguageModelV4ToolApprovalRequest, type LanguageModelV4ToolApprovalResponsePart, type LanguageModelV4ToolCall, type LanguageModelV4ToolCallPart, type LanguageModelV4ToolChoice, type LanguageModelV4ToolResult, type LanguageModelV4ToolResultOutput, type LanguageModelV4ToolResultPart, type LanguageModelV4Usage, LoadAPIKeyError, LoadSettingError, NoContentGeneratedError, NoSuchModelError, NoSuchProviderReferenceError, type ProviderV2, type ProviderV3, type ProviderV4, type RerankingModelV3, type RerankingModelV3CallOptions, type RerankingModelV4, type RerankingModelV4CallOptions, type RerankingModelV4Result, type SharedV2Headers, type SharedV2ProviderMetadata, type SharedV2ProviderOptions, type SharedV3Headers, type SharedV3ProviderMetadata, type SharedV3ProviderOptions, type SharedV3Warning, type SharedV4FileData, type SharedV4FileDataData, type SharedV4FileDataReference, type SharedV4FileDataText, type SharedV4FileDataUrl, type SharedV4Headers, type SharedV4ProviderMetadata, type SharedV4ProviderOptions, type SharedV4ProviderReference, type SharedV4Warning, type SkillsV4, type SkillsV4File, type SkillsV4UploadSkillCallOptions, type SkillsV4UploadSkillResult, type SpeechModelV2, type SpeechModelV2CallOptions, type SpeechModelV2CallWarning, type SpeechModelV3, type SpeechModelV3CallOptions, type SpeechModelV4, type SpeechModelV4CallOptions, type SpeechModelV4Result, TooManyEmbeddingValuesForCallError, type TranscriptionModelV2, type TranscriptionModelV2CallOptions, type TranscriptionModelV2CallWarning, type TranscriptionModelV3, type TranscriptionModelV3CallOptions, type TranscriptionModelV4, type TranscriptionModelV4CallOptions, type TranscriptionModelV4Result, type TypeValidationContext, TypeValidationError, UnsupportedFunctionalityError, getErrorMessage, isJSONArray, isJSONObject, isJSONValue };
package/package.json CHANGED
@@ -1,6 +1,6 @@
1
1
  {
2
2
  "name": "@ai-sdk/provider",
3
- "version": "4.0.0-canary.18",
3
+ "version": "4.0.1",
4
4
  "type": "module",
5
5
  "license": "Apache-2.0",
6
6
  "sideEffects": false,
@@ -4,3 +4,7 @@ export type {
4
4
  } from './video-model-v3';
5
5
  export type { VideoModelV3CallOptions as Experimental_VideoModelV3CallOptions } from './video-model-v3-call-options';
6
6
  export type { VideoModelV3File as Experimental_VideoModelV3File } from './video-model-v3-file';
7
+ export type {
8
+ VideoModelV3FrameImage as Experimental_VideoModelV3FrameImage,
9
+ VideoModelV3FrameType as Experimental_VideoModelV3FrameType,
10
+ } from './video-model-v3-frame-image';
@@ -1,5 +1,6 @@
1
1
  import type { SharedV3ProviderOptions } from '../../shared';
2
2
  import type { VideoModelV3File } from './video-model-v3-file';
3
+ import type { VideoModelV3FrameImage } from './video-model-v3-frame-image';
3
4
 
4
5
  export type VideoModelV3CallOptions = {
5
6
  /**
@@ -54,6 +55,23 @@ export type VideoModelV3CallOptions = {
54
55
  */
55
56
  image: VideoModelV3File | undefined;
56
57
 
58
+ /**
59
+ * Role-tagged image inputs for first-last-frame generation.
60
+ * Each entry declares whether it is the `first_frame` or the
61
+ * `last_frame` of the generated video.
62
+ */
63
+ frameImages: Array<VideoModelV3FrameImage> | undefined;
64
+
65
+ /**
66
+ * Reference image inputs for reference-to-video generation.
67
+ */
68
+ inputReferences: Array<VideoModelV3File> | undefined;
69
+
70
+ /**
71
+ * Whether the model should generate audio alongside the video.
72
+ */
73
+ generateAudio: boolean | undefined;
74
+
57
75
  /**
58
76
  * Additional provider-specific options that are passed through to the provider
59
77
  * as body parameters.
@@ -0,0 +1,24 @@
1
+ import type { VideoModelV3File } from './video-model-v3-file';
2
+
3
+ /**
4
+ * The role a frame image plays in video generation.
5
+ *
6
+ * - `first_frame`: the starting frame the model animates from
7
+ * - `last_frame`: the ending frame the model animates towards
8
+ */
9
+ export type VideoModelV3FrameType = 'first_frame' | 'last_frame';
10
+
11
+ /**
12
+ * A role-tagged image input for image-to-video and first-last-frame generation.
13
+ */
14
+ export type VideoModelV3FrameImage = {
15
+ /**
16
+ * The image file used for this frame.
17
+ */
18
+ image: VideoModelV3File;
19
+
20
+ /**
21
+ * Which frame this image represents.
22
+ */
23
+ frameType: VideoModelV3FrameType;
24
+ };
@@ -5,3 +5,7 @@ export type {
5
5
  VideoModelV4VideoData as Experimental_VideoModelV4VideoData,
6
6
  } from './video-model-v4-result';
7
7
  export type { VideoModelV4File as Experimental_VideoModelV4File } from './video-model-v4-file';
8
+ export type {
9
+ VideoModelV4FrameImage as Experimental_VideoModelV4FrameImage,
10
+ VideoModelV4FrameType as Experimental_VideoModelV4FrameType,
11
+ } from './video-model-v4-frame-image';
@@ -1,5 +1,6 @@
1
1
  import type { SharedV4ProviderOptions } from '../../shared';
2
2
  import type { VideoModelV4File } from './video-model-v4-file';
3
+ import type { VideoModelV4FrameImage } from './video-model-v4-frame-image';
3
4
 
4
5
  export type VideoModelV4CallOptions = {
5
6
  /**
@@ -54,6 +55,23 @@ export type VideoModelV4CallOptions = {
54
55
  */
55
56
  image: VideoModelV4File | undefined;
56
57
 
58
+ /**
59
+ * Role-tagged image inputs for first-last-frame generation.
60
+ * Each entry declares whether it is the `first_frame` or the
61
+ * `last_frame` of the generated video.
62
+ */
63
+ frameImages: Array<VideoModelV4FrameImage> | undefined;
64
+
65
+ /**
66
+ * Reference image inputs for reference-to-video generation.
67
+ */
68
+ inputReferences: Array<VideoModelV4File> | undefined;
69
+
70
+ /**
71
+ * Whether the model should generate audio alongside the video.
72
+ */
73
+ generateAudio: boolean | undefined;
74
+
57
75
  /**
58
76
  * Additional provider-specific options that are passed through to the provider
59
77
  * as body parameters.
@@ -0,0 +1,24 @@
1
+ import type { VideoModelV4File } from './video-model-v4-file';
2
+
3
+ /**
4
+ * The role a frame image plays in video generation.
5
+ *
6
+ * - `first_frame`: the starting frame the model animates from
7
+ * - `last_frame`: the ending frame the model animates towards
8
+ */
9
+ export type VideoModelV4FrameType = 'first_frame' | 'last_frame';
10
+
11
+ /**
12
+ * A role-tagged image input for image-to-video and first-last-frame generation.
13
+ */
14
+ export type VideoModelV4FrameImage = {
15
+ /**
16
+ * The image file used for this frame.
17
+ */
18
+ image: VideoModelV4File;
19
+
20
+ /**
21
+ * Which frame this image represents.
22
+ */
23
+ frameType: VideoModelV4FrameType;
24
+ };