@posthog/ai 8.4.2 → 8.4.3

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
@@ -198,7 +198,7 @@ function toContentString(content) {
198
198
  }
199
199
  return String(content);
200
200
  }
201
- const getModelParams = params => {
201
+ const getModelParams = (params, responseServiceTier) => {
202
202
  if (!params) {
203
203
  return {};
204
204
  }
@@ -209,6 +209,9 @@ const getModelParams = params => {
209
209
  modelParams[key] = params[key];
210
210
  }
211
211
  }
212
+ if (responseServiceTier != null) {
213
+ modelParams.service_tier = responseServiceTier;
214
+ }
212
215
  return modelParams;
213
216
  };
214
217
  const formatResponseOpenAI = response => {
@@ -530,7 +533,7 @@ function formatOpenAIResponsesInput(input, instructions) {
530
533
  return messages;
531
534
  }
532
535
 
533
- var version = "8.4.2";
536
+ var version = "8.4.3";
534
537
 
535
538
  const DEFAULT_MAX_DEPTH = 3;
536
539
  const MAX_STACK_LINES = 20;
@@ -884,6 +887,7 @@ let WrappedCompletions$1 = class WrappedCompletions extends AzureOpenAI.Chat.Com
884
887
  const contentBlocks = [];
885
888
  let accumulatedContent = '';
886
889
  let modelFromResponse;
890
+ let serviceTierFromResponse;
887
891
  let firstTokenTime;
888
892
  let usage = {
889
893
  inputTokens: 0,
@@ -903,6 +907,9 @@ let WrappedCompletions$1 = class WrappedCompletions extends AzureOpenAI.Chat.Com
903
907
  if (!systemFingerprintFromResponse && chunk.system_fingerprint) {
904
908
  systemFingerprintFromResponse = chunk.system_fingerprint;
905
909
  }
910
+ if (chunk.service_tier != null) {
911
+ serviceTierFromResponse = chunk.service_tier;
912
+ }
906
913
  const choice = chunk?.choices?.[0];
907
914
 
908
915
  // Handle text content
@@ -1003,7 +1010,7 @@ let WrappedCompletions$1 = class WrappedCompletions extends AzureOpenAI.Chat.Com
1003
1010
  latency,
1004
1011
  timeToFirstToken,
1005
1012
  baseURL: this.baseURL,
1006
- modelParameters: getModelParams(body),
1013
+ modelParameters: getModelParams(body, serviceTierFromResponse),
1007
1014
  httpStatus: 200,
1008
1015
  usage,
1009
1016
  completionId: completionIdFromResponse,
@@ -1058,7 +1065,7 @@ let WrappedCompletions$1 = class WrappedCompletions extends AzureOpenAI.Chat.Com
1058
1065
  output: formatResponseOpenAI(result),
1059
1066
  latency,
1060
1067
  baseURL: this.baseURL,
1061
- modelParameters: getModelParams(body),
1068
+ modelParameters: getModelParams(body, result.service_tier),
1062
1069
  httpStatus: 200,
1063
1070
  usage: {
1064
1071
  inputTokens: result.usage?.prompt_tokens ?? 0,
@@ -1130,6 +1137,7 @@ let WrappedResponses$1 = class WrappedResponses extends AzureOpenAI.Responses {
1130
1137
  try {
1131
1138
  let finalContent = [];
1132
1139
  let modelFromResponse;
1140
+ let serviceTierFromResponse;
1133
1141
  let firstTokenTime;
1134
1142
  let usage = {
1135
1143
  inputTokens: 0,
@@ -1148,6 +1156,9 @@ let WrappedResponses$1 = class WrappedResponses extends AzureOpenAI.Responses {
1148
1156
  if (!completionIdFromResponse && chunk.response.id) {
1149
1157
  completionIdFromResponse = chunk.response.id;
1150
1158
  }
1159
+ if (chunk.response.service_tier != null) {
1160
+ serviceTierFromResponse = chunk.response.service_tier;
1161
+ }
1151
1162
  }
1152
1163
  if (chunk.type === 'response.completed' && 'response' in chunk && chunk.response?.output && chunk.response.output.length > 0) {
1153
1164
  finalContent = chunk.response.output;
@@ -1172,7 +1183,7 @@ let WrappedResponses$1 = class WrappedResponses extends AzureOpenAI.Responses {
1172
1183
  latency,
1173
1184
  timeToFirstToken,
1174
1185
  baseURL: this.baseURL,
1175
- modelParameters: getModelParams(body),
1186
+ modelParameters: getModelParams(body, serviceTierFromResponse),
1176
1187
  httpStatus: 200,
1177
1188
  usage,
1178
1189
  completionId: completionIdFromResponse
@@ -1218,7 +1229,7 @@ let WrappedResponses$1 = class WrappedResponses extends AzureOpenAI.Responses {
1218
1229
  output: result.output,
1219
1230
  latency,
1220
1231
  baseURL: this.baseURL,
1221
- modelParameters: getModelParams(body),
1232
+ modelParameters: getModelParams(body, result.service_tier),
1222
1233
  httpStatus: 200,
1223
1234
  usage: {
1224
1235
  inputTokens: result.usage?.input_tokens ?? 0,
@@ -1273,7 +1284,7 @@ let WrappedResponses$1 = class WrappedResponses extends AzureOpenAI.Responses {
1273
1284
  output: result.output,
1274
1285
  latency,
1275
1286
  baseURL: this.baseURL,
1276
- modelParameters: getModelParams(body),
1287
+ modelParameters: getModelParams(body, result.service_tier),
1277
1288
  httpStatus: 200,
1278
1289
  usage: {
1279
1290
  inputTokens: result.usage?.input_tokens ?? 0,
@@ -1459,6 +1470,7 @@ class WrappedCompletions extends Completions {
1459
1470
  const contentBlocks = [];
1460
1471
  let accumulatedContent = '';
1461
1472
  let modelFromResponse;
1473
+ let serviceTierFromResponse;
1462
1474
  let firstTokenTime;
1463
1475
  let stopReason;
1464
1476
  let usage = {
@@ -1481,6 +1493,9 @@ class WrappedCompletions extends Completions {
1481
1493
  if (!systemFingerprintFromResponse && chunk.system_fingerprint) {
1482
1494
  systemFingerprintFromResponse = chunk.system_fingerprint;
1483
1495
  }
1496
+ if (chunk.service_tier != null) {
1497
+ serviceTierFromResponse = chunk.service_tier;
1498
+ }
1484
1499
  const choice = chunk?.choices?.[0];
1485
1500
  if (choice?.finish_reason) {
1486
1501
  stopReason = choice.finish_reason;
@@ -1591,7 +1606,7 @@ class WrappedCompletions extends Completions {
1591
1606
  latency,
1592
1607
  timeToFirstToken,
1593
1608
  baseURL: this.baseURL,
1594
- modelParameters: getModelParams(body),
1609
+ modelParameters: getModelParams(body, serviceTierFromResponse),
1595
1610
  httpStatus: 200,
1596
1611
  usage: {
1597
1612
  inputTokens: usage.inputTokens,
@@ -1658,7 +1673,7 @@ class WrappedCompletions extends Completions {
1658
1673
  output: formattedOutput,
1659
1674
  latency,
1660
1675
  baseURL: this.baseURL,
1661
- modelParameters: getModelParams(body),
1676
+ modelParameters: getModelParams(body, result.service_tier),
1662
1677
  httpStatus: 200,
1663
1678
  usage: {
1664
1679
  inputTokens: result.usage?.prompt_tokens ?? 0,
@@ -1734,6 +1749,7 @@ class WrappedResponses extends Responses {
1734
1749
  try {
1735
1750
  let finalContent = [];
1736
1751
  let modelFromResponse;
1752
+ let serviceTierFromResponse;
1737
1753
  let firstTokenTime;
1738
1754
  let stopReason;
1739
1755
  let usage = {
@@ -1755,6 +1771,9 @@ class WrappedResponses extends Responses {
1755
1771
  if (!completionIdFromResponse && chunk.response.id) {
1756
1772
  completionIdFromResponse = chunk.response.id;
1757
1773
  }
1774
+ if (chunk.response.service_tier != null) {
1775
+ serviceTierFromResponse = chunk.response.service_tier;
1776
+ }
1758
1777
  const chunkWebSearchCount = calculateWebSearchCount(chunk.response);
1759
1778
  if (chunkWebSearchCount > 0 && chunkWebSearchCount > (usage.webSearchCount ?? 0)) {
1760
1779
  usage.webSearchCount = chunkWebSearchCount;
@@ -1789,7 +1808,7 @@ class WrappedResponses extends Responses {
1789
1808
  latency,
1790
1809
  timeToFirstToken,
1791
1810
  baseURL: this.baseURL,
1792
- modelParameters: getModelParams(body),
1811
+ modelParameters: getModelParams(body, serviceTierFromResponse),
1793
1812
  httpStatus: 200,
1794
1813
  usage: {
1795
1814
  inputTokens: usage.inputTokens,
@@ -1852,7 +1871,7 @@ class WrappedResponses extends Responses {
1852
1871
  output: formattedOutput,
1853
1872
  latency,
1854
1873
  baseURL: this.baseURL,
1855
- modelParameters: getModelParams(body),
1874
+ modelParameters: getModelParams(body, result.service_tier),
1856
1875
  httpStatus: 200,
1857
1876
  usage: {
1858
1877
  inputTokens: result.usage?.input_tokens ?? 0,
@@ -1919,7 +1938,7 @@ class WrappedResponses extends Responses {
1919
1938
  output: result.output,
1920
1939
  latency,
1921
1940
  baseURL: this.baseURL,
1922
- modelParameters: getModelParams(body),
1941
+ modelParameters: getModelParams(body, result.service_tier),
1923
1942
  httpStatus: 200,
1924
1943
  usage: {
1925
1944
  inputTokens: result.usage?.input_tokens ?? 0,