@posthog/ai 8.4.2 → 8.4.3

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
@@ -202,7 +202,7 @@ function toContentString(content) {
202
202
  }
203
203
  return String(content);
204
204
  }
205
- const getModelParams = params => {
205
+ const getModelParams = (params, responseServiceTier) => {
206
206
  if (!params) {
207
207
  return {};
208
208
  }
@@ -213,6 +213,9 @@ const getModelParams = params => {
213
213
  modelParams[key] = params[key];
214
214
  }
215
215
  }
216
+ if (responseServiceTier != null) {
217
+ modelParams.service_tier = responseServiceTier;
218
+ }
216
219
  return modelParams;
217
220
  };
218
221
  const formatResponseOpenAI = response => {
@@ -534,7 +537,7 @@ function formatOpenAIResponsesInput(input, instructions) {
534
537
  return messages;
535
538
  }
536
539
 
537
- var version = "8.4.2";
540
+ var version = "8.4.3";
538
541
 
539
542
  const DEFAULT_MAX_DEPTH = 3;
540
543
  const MAX_STACK_LINES = 20;
@@ -888,6 +891,7 @@ let WrappedCompletions$1 = class WrappedCompletions extends openai.AzureOpenAI.C
888
891
  const contentBlocks = [];
889
892
  let accumulatedContent = '';
890
893
  let modelFromResponse;
894
+ let serviceTierFromResponse;
891
895
  let firstTokenTime;
892
896
  let usage = {
893
897
  inputTokens: 0,
@@ -907,6 +911,9 @@ let WrappedCompletions$1 = class WrappedCompletions extends openai.AzureOpenAI.C
907
911
  if (!systemFingerprintFromResponse && chunk.system_fingerprint) {
908
912
  systemFingerprintFromResponse = chunk.system_fingerprint;
909
913
  }
914
+ if (chunk.service_tier != null) {
915
+ serviceTierFromResponse = chunk.service_tier;
916
+ }
910
917
  const choice = chunk?.choices?.[0];
911
918
 
912
919
  // Handle text content
@@ -1007,7 +1014,7 @@ let WrappedCompletions$1 = class WrappedCompletions extends openai.AzureOpenAI.C
1007
1014
  latency,
1008
1015
  timeToFirstToken,
1009
1016
  baseURL: this.baseURL,
1010
- modelParameters: getModelParams(body),
1017
+ modelParameters: getModelParams(body, serviceTierFromResponse),
1011
1018
  httpStatus: 200,
1012
1019
  usage,
1013
1020
  completionId: completionIdFromResponse,
@@ -1062,7 +1069,7 @@ let WrappedCompletions$1 = class WrappedCompletions extends openai.AzureOpenAI.C
1062
1069
  output: formatResponseOpenAI(result),
1063
1070
  latency,
1064
1071
  baseURL: this.baseURL,
1065
- modelParameters: getModelParams(body),
1072
+ modelParameters: getModelParams(body, result.service_tier),
1066
1073
  httpStatus: 200,
1067
1074
  usage: {
1068
1075
  inputTokens: result.usage?.prompt_tokens ?? 0,
@@ -1134,6 +1141,7 @@ let WrappedResponses$1 = class WrappedResponses extends openai.AzureOpenAI.Respo
1134
1141
  try {
1135
1142
  let finalContent = [];
1136
1143
  let modelFromResponse;
1144
+ let serviceTierFromResponse;
1137
1145
  let firstTokenTime;
1138
1146
  let usage = {
1139
1147
  inputTokens: 0,
@@ -1152,6 +1160,9 @@ let WrappedResponses$1 = class WrappedResponses extends openai.AzureOpenAI.Respo
1152
1160
  if (!completionIdFromResponse && chunk.response.id) {
1153
1161
  completionIdFromResponse = chunk.response.id;
1154
1162
  }
1163
+ if (chunk.response.service_tier != null) {
1164
+ serviceTierFromResponse = chunk.response.service_tier;
1165
+ }
1155
1166
  }
1156
1167
  if (chunk.type === 'response.completed' && 'response' in chunk && chunk.response?.output && chunk.response.output.length > 0) {
1157
1168
  finalContent = chunk.response.output;
@@ -1176,7 +1187,7 @@ let WrappedResponses$1 = class WrappedResponses extends openai.AzureOpenAI.Respo
1176
1187
  latency,
1177
1188
  timeToFirstToken,
1178
1189
  baseURL: this.baseURL,
1179
- modelParameters: getModelParams(body),
1190
+ modelParameters: getModelParams(body, serviceTierFromResponse),
1180
1191
  httpStatus: 200,
1181
1192
  usage,
1182
1193
  completionId: completionIdFromResponse
@@ -1222,7 +1233,7 @@ let WrappedResponses$1 = class WrappedResponses extends openai.AzureOpenAI.Respo
1222
1233
  output: result.output,
1223
1234
  latency,
1224
1235
  baseURL: this.baseURL,
1225
- modelParameters: getModelParams(body),
1236
+ modelParameters: getModelParams(body, result.service_tier),
1226
1237
  httpStatus: 200,
1227
1238
  usage: {
1228
1239
  inputTokens: result.usage?.input_tokens ?? 0,
@@ -1277,7 +1288,7 @@ let WrappedResponses$1 = class WrappedResponses extends openai.AzureOpenAI.Respo
1277
1288
  output: result.output,
1278
1289
  latency,
1279
1290
  baseURL: this.baseURL,
1280
- modelParameters: getModelParams(body),
1291
+ modelParameters: getModelParams(body, result.service_tier),
1281
1292
  httpStatus: 200,
1282
1293
  usage: {
1283
1294
  inputTokens: result.usage?.input_tokens ?? 0,
@@ -1463,6 +1474,7 @@ class WrappedCompletions extends Completions {
1463
1474
  const contentBlocks = [];
1464
1475
  let accumulatedContent = '';
1465
1476
  let modelFromResponse;
1477
+ let serviceTierFromResponse;
1466
1478
  let firstTokenTime;
1467
1479
  let stopReason;
1468
1480
  let usage = {
@@ -1485,6 +1497,9 @@ class WrappedCompletions extends Completions {
1485
1497
  if (!systemFingerprintFromResponse && chunk.system_fingerprint) {
1486
1498
  systemFingerprintFromResponse = chunk.system_fingerprint;
1487
1499
  }
1500
+ if (chunk.service_tier != null) {
1501
+ serviceTierFromResponse = chunk.service_tier;
1502
+ }
1488
1503
  const choice = chunk?.choices?.[0];
1489
1504
  if (choice?.finish_reason) {
1490
1505
  stopReason = choice.finish_reason;
@@ -1595,7 +1610,7 @@ class WrappedCompletions extends Completions {
1595
1610
  latency,
1596
1611
  timeToFirstToken,
1597
1612
  baseURL: this.baseURL,
1598
- modelParameters: getModelParams(body),
1613
+ modelParameters: getModelParams(body, serviceTierFromResponse),
1599
1614
  httpStatus: 200,
1600
1615
  usage: {
1601
1616
  inputTokens: usage.inputTokens,
@@ -1662,7 +1677,7 @@ class WrappedCompletions extends Completions {
1662
1677
  output: formattedOutput,
1663
1678
  latency,
1664
1679
  baseURL: this.baseURL,
1665
- modelParameters: getModelParams(body),
1680
+ modelParameters: getModelParams(body, result.service_tier),
1666
1681
  httpStatus: 200,
1667
1682
  usage: {
1668
1683
  inputTokens: result.usage?.prompt_tokens ?? 0,
@@ -1738,6 +1753,7 @@ class WrappedResponses extends Responses {
1738
1753
  try {
1739
1754
  let finalContent = [];
1740
1755
  let modelFromResponse;
1756
+ let serviceTierFromResponse;
1741
1757
  let firstTokenTime;
1742
1758
  let stopReason;
1743
1759
  let usage = {
@@ -1759,6 +1775,9 @@ class WrappedResponses extends Responses {
1759
1775
  if (!completionIdFromResponse && chunk.response.id) {
1760
1776
  completionIdFromResponse = chunk.response.id;
1761
1777
  }
1778
+ if (chunk.response.service_tier != null) {
1779
+ serviceTierFromResponse = chunk.response.service_tier;
1780
+ }
1762
1781
  const chunkWebSearchCount = calculateWebSearchCount(chunk.response);
1763
1782
  if (chunkWebSearchCount > 0 && chunkWebSearchCount > (usage.webSearchCount ?? 0)) {
1764
1783
  usage.webSearchCount = chunkWebSearchCount;
@@ -1793,7 +1812,7 @@ class WrappedResponses extends Responses {
1793
1812
  latency,
1794
1813
  timeToFirstToken,
1795
1814
  baseURL: this.baseURL,
1796
- modelParameters: getModelParams(body),
1815
+ modelParameters: getModelParams(body, serviceTierFromResponse),
1797
1816
  httpStatus: 200,
1798
1817
  usage: {
1799
1818
  inputTokens: usage.inputTokens,
@@ -1856,7 +1875,7 @@ class WrappedResponses extends Responses {
1856
1875
  output: formattedOutput,
1857
1876
  latency,
1858
1877
  baseURL: this.baseURL,
1859
- modelParameters: getModelParams(body),
1878
+ modelParameters: getModelParams(body, result.service_tier),
1860
1879
  httpStatus: 200,
1861
1880
  usage: {
1862
1881
  inputTokens: result.usage?.input_tokens ?? 0,
@@ -1923,7 +1942,7 @@ class WrappedResponses extends Responses {
1923
1942
  output: result.output,
1924
1943
  latency,
1925
1944
  baseURL: this.baseURL,
1926
- modelParameters: getModelParams(body),
1945
+ modelParameters: getModelParams(body, result.service_tier),
1927
1946
  httpStatus: 200,
1928
1947
  usage: {
1929
1948
  inputTokens: result.usage?.input_tokens ?? 0,