runbios-sdk 0.2.1-dev.62 → 0.2.1-dev.66
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/dist/index.d.ts +2 -2
- package/dist/index.js +1 -1
- package/dist/types.d.ts +33 -2
- package/package.json +1 -1
package/dist/index.d.ts
CHANGED
|
@@ -34,7 +34,7 @@ import { Inference } from './resources/inference.js';
|
|
|
34
34
|
* SDK version. Sent as part of the User-Agent header.
|
|
35
35
|
* Must match package.json "version" -- enforced by a contract test.
|
|
36
36
|
*/
|
|
37
|
-
export declare const VERSION = "0.2.1-dev.
|
|
37
|
+
export declare const VERSION = "0.2.1-dev.66";
|
|
38
38
|
export declare class RunBiOS {
|
|
39
39
|
/** Search models, fetch configs, check adapter compatibility. */
|
|
40
40
|
readonly models: Models;
|
|
@@ -65,4 +65,4 @@ export { Training } from './resources/training.js';
|
|
|
65
65
|
export { Wallet } from './resources/wallet.js';
|
|
66
66
|
export { GPU, type GPURecommendation } from './resources/gpu.js';
|
|
67
67
|
export { Inference, validateChatRequest, parseSSE, buildInferenceRequest, contextSizingBasis, type ContextSizingBasis, CONTEXT_DEFAULT_CEILING, CONTEXT_EDITABLE_FLOOR, type ChatMessage, type FunctionTool, type ChatCompletionParams, type ChatCompletionResponse, type ChatCompletionChunk, } from './resources/inference.js';
|
|
68
|
-
export type { BiOSConfig, PaginatedResponse, ApiErrorBody, AvailableGpuAlternative, CapacityMinimumRequirement, InferenceBookingAccepted, Model, ModelSearchParams, ModelSearchResponse, ModelDetailResponse, ModelConfig, Dataset, DatasetListParams, DatasetListResponse, DatasetUploadParams, DatasetPreview, DatasetPreviewParams, DatasetImportHFParams, DatasetRegisterHFParams, DatasetHubSearchParams, DatasetHubPreviewParams, DatasetValidation, DatasetFormatVariant, DatasetFormatSpec, DatasetFormatSpecs, DatasetStorageUsage, TrainingMethod, RLHFAlgorithm, AdapterType, TrainingJobStatus, TrainingStatusFilter, TrainingCreateParams, TrainingListParams, TrainingListResponse, TrainingJob, TrainingMetrics, MetricPoint, MetricGraphConfig, TrainingCheckpoint, TrainingLogs, TrainingLogEntry, TrainingStopResponse, TrainingResumeResponse, CanonicalTrainingRequest, TrainingPreflightDataset, TrainingPreflightWarning, TrainingPreflightResponse, TrainingCapabilityChoice, TrainingConfigFieldCapability, TrainingCapabilities, GPUChoice, WalletBalance, Transaction, TransactionListResponse, TransactionListParams, GPUInfo, GPUPricingResponse, GPUOptionsParams, GPUOption, GPUOptionSuggestion, GPUOptionsResponse, InferenceStatus, InferenceCreateParams, InferenceUpdateParams, InferenceDeployment, InferenceDeploymentSummary, InferenceCreateResponse, InferenceListResponse, InferenceUpdateResponse, InferenceLifecycleResponse, InferenceDeleteResponse, InferenceGPUOptionMarket, InferenceGPUOption, InferenceGPUAlternative, InferenceGPUOptionsParams, InferenceGPUOptionsResponse, InferenceCanonicalRequest, InferencePreflightWarning, InferencePreflightResponse, AdapterCompatibility, AdapterCompatibilityResponse, AdapterCompatibilityParams, SupportedArchitecture, ArchitectureScope, SupportedArchitecturesResponse, ApiKey, ApiKeyScope, ApiKeyIntrospection, Organization, OrgMember, OrgInvite, Workspace, Integration, IntegrationCreateParams, StorageUsage, StorageObject, } from './types.js';
|
|
68
|
+
export type { BiOSConfig, PaginatedResponse, ApiErrorBody, AvailableGpuAlternative, CapacityMinimumRequirement, InferenceBookingAccepted, Model, ModelSearchParams, ModelSearchResponse, ModelDetailResponse, ModelConfig, Dataset, DatasetListParams, DatasetListResponse, DatasetUploadParams, DatasetPreview, DatasetPreviewParams, DatasetImportHFParams, DatasetRegisterHFParams, DatasetHubSearchParams, DatasetHubPreviewParams, DatasetValidation, DatasetFormatVariant, DatasetFormatSpec, DatasetFormatSpecs, DatasetStorageUsage, TrainingMethod, RLHFAlgorithm, AdapterType, TrainingJobStatus, TrainingStatusFilter, TrainingCreateParams, TrainingListParams, TrainingListResponse, TrainingJob, TrainingMetrics, MetricPoint, MetricGraphConfig, TrainingCheckpoint, TrainingLogs, TrainingLogEntry, TrainingStopResponse, TrainingResumeResponse, CanonicalTrainingRequest, TrainingPreflightDataset, TrainingPreflightWarning, TrainingPreflightResponse, TrainingCapabilityChoice, TrainingConfigFieldCapability, TrainingCapabilities, GPUChoice, WalletBalance, Transaction, TransactionListResponse, TransactionListParams, GPUInfo, GPUPricingResponse, GPUOptionsParams, GPUOption, GPUOptionSuggestion, GPUOptionsResponse, InferenceStatus, InferenceCreateParams, InferenceUpdateParams, InferenceDeployment, InferenceDeploymentSummary, InferenceCreateResponse, InferenceListResponse, InferenceUpdateResponse, InferenceLifecycleResponse, InferenceDeleteResponse, InferenceGPUOptionMarket, InferenceGPUOption, InferenceGPUAlternative, InferenceGPUOptionsParams, InferenceGPUOptionsResponse, InferenceCanonicalRequest, InferencePreflightWarning, InferencePreflightResponse, AdapterCompatibility, AdapterCompatibilityResponse, AdapterCompatibilityParams, SupportedArchitecture, ArchitectureScope, SupportedArchitecturesResponse, ApiKey, ApiKeyScope, ApiKeyIntrospection, Organization, OrgMember, OrgInvite, Workspace, Integration, IntegrationCreateParams, StorageUsage, StorageObject, PromptTokensDetails, ChatCompletionUsage, } from './types.js';
|
package/dist/index.js
CHANGED
|
@@ -34,7 +34,7 @@ import { Inference } from './resources/inference.js';
|
|
|
34
34
|
* SDK version. Sent as part of the User-Agent header.
|
|
35
35
|
* Must match package.json "version" -- enforced by a contract test.
|
|
36
36
|
*/
|
|
37
|
-
export const VERSION = '0.2.1-dev.
|
|
37
|
+
export const VERSION = '0.2.1-dev.66';
|
|
38
38
|
export class RunBiOS {
|
|
39
39
|
/** Search models, fetch configs, check adapter compatibility. */
|
|
40
40
|
models;
|
package/dist/types.d.ts
CHANGED
|
@@ -204,8 +204,11 @@ export interface ModelDetailResponse {
|
|
|
204
204
|
model: Model;
|
|
205
205
|
/** Whether the file/config viewer applies -- public models only. */
|
|
206
206
|
files_viewable?: boolean;
|
|
207
|
-
/**
|
|
208
|
-
|
|
207
|
+
/**
|
|
208
|
+
* The curated model card (markdown); present only for public models whose
|
|
209
|
+
* card has been curated. The raw upstream README is never served.
|
|
210
|
+
*/
|
|
211
|
+
card_md?: string;
|
|
209
212
|
/**
|
|
210
213
|
* The revision this card and file list describe -- the one hosted in our
|
|
211
214
|
* mirror. Public models only, and only once something is mirrored.
|
|
@@ -1914,3 +1917,31 @@ export interface StorageObject {
|
|
|
1914
1917
|
size_bytes: number;
|
|
1915
1918
|
created_at: string;
|
|
1916
1919
|
}
|
|
1920
|
+
/**
|
|
1921
|
+
* Prompt-cache slices on a chat completion `usage` object. All three counts
|
|
1922
|
+
* are slices of `prompt_tokens` (cached + writes <= prompt), never additions
|
|
1923
|
+
* to it, and they are the BILLED counts — what the invoice charged, in the
|
|
1924
|
+
* model's public token vocabulary.
|
|
1925
|
+
*
|
|
1926
|
+
* The whole block is absent when the request had no cache activity, so treat
|
|
1927
|
+
* a missing block as "no caching happened", not as zero-with-certainty.
|
|
1928
|
+
* `cached_tokens` is always present inside the block (0 means "wrote but read
|
|
1929
|
+
* nothing back"); the two write counts appear only when non-zero and only on
|
|
1930
|
+
* models that price cache writes separately.
|
|
1931
|
+
*/
|
|
1932
|
+
export interface PromptTokensDetails {
|
|
1933
|
+
cached_tokens: number;
|
|
1934
|
+
cache_write_5m_tokens?: number;
|
|
1935
|
+
cache_write_1h_tokens?: number;
|
|
1936
|
+
}
|
|
1937
|
+
/**
|
|
1938
|
+
* Token usage on a `/v1/chat/completions` response (non-stream body, or the
|
|
1939
|
+
* terminal stream chunk when `stream_options.include_usage` was requested).
|
|
1940
|
+
* `total_tokens` is always `prompt_tokens + completion_tokens`.
|
|
1941
|
+
*/
|
|
1942
|
+
export interface ChatCompletionUsage {
|
|
1943
|
+
prompt_tokens: number;
|
|
1944
|
+
completion_tokens: number;
|
|
1945
|
+
total_tokens: number;
|
|
1946
|
+
prompt_tokens_details?: PromptTokensDetails;
|
|
1947
|
+
}
|