renderers 0.1.9.dev4__tar.gz → 0.1.9.dev5__tar.gz
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/PKG-INFO +1 -1
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/__init__.py +2 -1
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/_version.py +2 -2
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/client.py +70 -5
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_client.py +119 -20
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/.github/workflows/publish-dev.yml +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/.github/workflows/publish.yml +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/.github/workflows/style.yml +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/.github/workflows/test.yml +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/.gitignore +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/.pre-commit-config.yaml +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/LICENSE +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/README.md +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/docs/renderer-config.md +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/examples/README.md +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/examples/sglang/multiturn_generate_sglang.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/examples/sglang/online_multiturn_sglang.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/examples/tinker/multiturn_generate_tinker.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/examples/transformers/multiturn_generate_transformers.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/examples/vllm/multiturn_generate_vllm.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/pyproject.toml +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/base.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/configs.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/deepseek_r1.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/deepseek_v3.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/default.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/glm45.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/glm5.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/gpt_oss.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/hy3.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/kimi_k2.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/kimi_k25.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/laguna_xs2.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/llama_3.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/minimax_m2.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/nemotron3.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/parsers.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/parsing.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/prime_qwen3.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/qwen3.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/qwen35.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/qwen36.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/renderers/qwen3_vl.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/conftest.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_bridge.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_build_helpers.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_deepseek_r1.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_disabled_thinking_stability.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_gpt_oss_harmony_parity.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_hy3.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_incremental.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_is_content.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_kimi_k25_tool_schema.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_laguna_xs21.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_llama_3.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_load_tokenizer.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_message_indices.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_message_tool_names.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_multimodal.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_nemotron3_parity.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_nemotron3_ultra.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_parse_response.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_parse_response_robustness.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_parsers.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_preserve_thinking.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_prime_qwen3_parity.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_qwen35_size_coverage.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_render_ids.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_renderer_config.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_renderer_config_parity.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_roundtrip.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_sampled_mask.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_tokens_per_message.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/tests/test_tool_arg_type_preservation.py +0 -0
- {renderers-0.1.9.dev4 → renderers-0.1.9.dev5}/uv.lock +0 -0
|
@@ -39,7 +39,7 @@ from renderers.base import (
|
|
|
39
39
|
reject_assistant_in_extension,
|
|
40
40
|
trim_to_turn_close,
|
|
41
41
|
)
|
|
42
|
-
from renderers.client import OverlongPromptError
|
|
42
|
+
from renderers.client import MalformedGenerateResponseError, OverlongPromptError
|
|
43
43
|
from renderers.configs import (
|
|
44
44
|
AutoRendererConfig,
|
|
45
45
|
BaseRendererConfig,
|
|
@@ -152,6 +152,7 @@ __all__ = [
|
|
|
152
152
|
"Llama3Renderer",
|
|
153
153
|
"Llama3RendererConfig",
|
|
154
154
|
"MULTIMODAL_MODELS",
|
|
155
|
+
"MalformedGenerateResponseError",
|
|
155
156
|
"Message",
|
|
156
157
|
"MiniMaxM2Renderer",
|
|
157
158
|
"MiniMaxM2RendererConfig",
|
|
@@ -18,7 +18,7 @@ version_tuple: tuple[int | str, ...]
|
|
|
18
18
|
commit_id: str | None
|
|
19
19
|
__commit_id__: str | None
|
|
20
20
|
|
|
21
|
-
__version__ = version = '0.1.9.
|
|
22
|
-
__version_tuple__ = version_tuple = (0, 1, 9, '
|
|
21
|
+
__version__ = version = '0.1.9.dev5'
|
|
22
|
+
__version_tuple__ = version_tuple = (0, 1, 9, 'dev5')
|
|
23
23
|
|
|
24
24
|
__commit_id__ = commit_id = None
|
|
@@ -14,6 +14,7 @@ from __future__ import annotations
|
|
|
14
14
|
import asyncio
|
|
15
15
|
import json
|
|
16
16
|
import logging
|
|
17
|
+
import math
|
|
17
18
|
from collections.abc import Mapping
|
|
18
19
|
from typing import Any, cast
|
|
19
20
|
|
|
@@ -33,6 +34,9 @@ from renderers.base import (
|
|
|
33
34
|
_request_logger = logging.getLogger("renderers.client")
|
|
34
35
|
ROUTED_EXPERTS_DATA_PREFIX = b'"routed_experts":{"data":"'
|
|
35
36
|
KEPT_TOKENS_IDS_PREFIX = b'"kept_tokens":{"ids":"'
|
|
37
|
+
# vLLM uses this value both when sampled-token evidence is missing and as a
|
|
38
|
+
# lower-bound clamp, so receiving it cannot prove the real logprob was returned.
|
|
39
|
+
VLLM_LOGPROB_SENTINEL = -9999.0
|
|
36
40
|
|
|
37
41
|
|
|
38
42
|
class OverlongPromptError(Exception):
|
|
@@ -59,6 +63,10 @@ class OverlongPromptError(Exception):
|
|
|
59
63
|
)
|
|
60
64
|
|
|
61
65
|
|
|
66
|
+
class MalformedGenerateResponseError(ValueError):
|
|
67
|
+
"""The generate endpoint returned unusable sampled-token evidence."""
|
|
68
|
+
|
|
69
|
+
|
|
62
70
|
# Per-process cache of resolved engine context-length caps, keyed by
|
|
63
71
|
# ``(base_url, model)``. ``None`` is the "we asked the engine and it didn't
|
|
64
72
|
# tell us" sentinel — distinct from "key missing" (haven't asked yet). The
|
|
@@ -150,6 +158,66 @@ def parse_generate_response(raw: bytes) -> dict[str, Any]:
|
|
|
150
158
|
return payload
|
|
151
159
|
|
|
152
160
|
|
|
161
|
+
def _parse_completion_logprobs(
|
|
162
|
+
choice: Mapping[str, Any], completion_ids: list[int]
|
|
163
|
+
) -> list[float]:
|
|
164
|
+
raw_logprobs = choice.get("logprobs")
|
|
165
|
+
if not isinstance(raw_logprobs, Mapping):
|
|
166
|
+
raise MalformedGenerateResponseError(
|
|
167
|
+
"Engine response choice.logprobs must be an object."
|
|
168
|
+
)
|
|
169
|
+
|
|
170
|
+
content = raw_logprobs.get("content")
|
|
171
|
+
if not isinstance(content, list):
|
|
172
|
+
raise MalformedGenerateResponseError(
|
|
173
|
+
"Engine response choice.logprobs.content must be a list."
|
|
174
|
+
)
|
|
175
|
+
if len(content) != len(completion_ids):
|
|
176
|
+
raise MalformedGenerateResponseError(
|
|
177
|
+
"Engine response completion token count "
|
|
178
|
+
f"({len(completion_ids)}) does not match logprob count ({len(content)})."
|
|
179
|
+
)
|
|
180
|
+
|
|
181
|
+
completion_logprobs: list[float] = []
|
|
182
|
+
for index, entry in enumerate(content):
|
|
183
|
+
if not isinstance(entry, Mapping):
|
|
184
|
+
raise MalformedGenerateResponseError(
|
|
185
|
+
f"Engine response choice.logprobs.content[{index}] must be an object."
|
|
186
|
+
)
|
|
187
|
+
expected_token = f"token_id:{completion_ids[index]}"
|
|
188
|
+
if entry.get("token") != expected_token:
|
|
189
|
+
raise MalformedGenerateResponseError(
|
|
190
|
+
"Engine response "
|
|
191
|
+
f"choice.logprobs.content[{index}].token must be {expected_token!r}."
|
|
192
|
+
)
|
|
193
|
+
raw_logprob = entry.get("logprob")
|
|
194
|
+
if isinstance(raw_logprob, bool) or not isinstance(raw_logprob, (int, float)):
|
|
195
|
+
raise MalformedGenerateResponseError(
|
|
196
|
+
"Engine response "
|
|
197
|
+
f"choice.logprobs.content[{index}].logprob must be a number."
|
|
198
|
+
)
|
|
199
|
+
try:
|
|
200
|
+
logprob = float(raw_logprob)
|
|
201
|
+
except OverflowError as exc:
|
|
202
|
+
raise MalformedGenerateResponseError(
|
|
203
|
+
"Engine response "
|
|
204
|
+
f"choice.logprobs.content[{index}].logprob must be finite."
|
|
205
|
+
) from exc
|
|
206
|
+
if not math.isfinite(logprob):
|
|
207
|
+
raise MalformedGenerateResponseError(
|
|
208
|
+
"Engine response "
|
|
209
|
+
f"choice.logprobs.content[{index}].logprob must be finite."
|
|
210
|
+
)
|
|
211
|
+
if logprob == VLLM_LOGPROB_SENTINEL:
|
|
212
|
+
raise MalformedGenerateResponseError(
|
|
213
|
+
"Engine response "
|
|
214
|
+
f"choice.logprobs.content[{index}].logprob does not contain "
|
|
215
|
+
"sampling evidence."
|
|
216
|
+
)
|
|
217
|
+
completion_logprobs.append(logprob)
|
|
218
|
+
return completion_logprobs
|
|
219
|
+
|
|
220
|
+
|
|
153
221
|
async def generate(
|
|
154
222
|
*,
|
|
155
223
|
client: AsyncOpenAI,
|
|
@@ -292,15 +360,12 @@ async def generate(
|
|
|
292
360
|
choice = (data.get("choices") or [{}])[0]
|
|
293
361
|
completion_ids = choice.get("token_ids") or []
|
|
294
362
|
|
|
363
|
+
completion_logprobs = _parse_completion_logprobs(choice, completion_ids)
|
|
364
|
+
|
|
295
365
|
parsed = await _maybe_offload(
|
|
296
366
|
renderer, lambda: renderer.parse_response(completion_ids, tools=tools)
|
|
297
367
|
)
|
|
298
368
|
|
|
299
|
-
# ChatCompletionLogProbs flatten: {"content": [{"logprob": ...}, ...]}
|
|
300
|
-
raw_logprobs = choice.get("logprobs") or {}
|
|
301
|
-
content_lp = raw_logprobs.get("content") if isinstance(raw_logprobs, dict) else None
|
|
302
|
-
completion_logprobs = [float(c.get("logprob") or 0.0) for c in content_lp or []]
|
|
303
|
-
|
|
304
369
|
routed_experts = choice.get("routed_experts")
|
|
305
370
|
kept_tokens = choice.get("kept_tokens")
|
|
306
371
|
|
|
@@ -5,6 +5,7 @@ import json
|
|
|
5
5
|
import httpx
|
|
6
6
|
import numpy as np
|
|
7
7
|
import pytest
|
|
8
|
+
from renderers import MalformedGenerateResponseError
|
|
8
9
|
from renderers.base import (
|
|
9
10
|
ParsedResponse,
|
|
10
11
|
ParsedToolCall,
|
|
@@ -67,33 +68,30 @@ class _FakeClient:
|
|
|
67
68
|
def __init__(self):
|
|
68
69
|
self.calls = []
|
|
69
70
|
self.base_url = "http://fake-host:8000/v1"
|
|
71
|
+
routed_experts = np.array([[[1]], [[2]]], dtype=np.uint8)
|
|
72
|
+
self.choice = {
|
|
73
|
+
"index": 0,
|
|
74
|
+
"token_ids": [7, 8],
|
|
75
|
+
"logprobs": {
|
|
76
|
+
"content": [
|
|
77
|
+
{"token": "token_id:7", "logprob": -0.1},
|
|
78
|
+
{"token": "token_id:8", "logprob": -0.2},
|
|
79
|
+
]
|
|
80
|
+
},
|
|
81
|
+
"finish_reason": "stop",
|
|
82
|
+
"routed_experts": {
|
|
83
|
+
"data": base64.b64encode(routed_experts.tobytes()).decode("ascii"),
|
|
84
|
+
"shape": list(routed_experts.shape),
|
|
85
|
+
},
|
|
86
|
+
}
|
|
70
87
|
|
|
71
88
|
async def post(self, path, *, cast_to=dict, body=None, options=None):
|
|
72
89
|
self.calls.append(
|
|
73
90
|
{"path": path, "cast_to": cast_to, "body": body, "options": options}
|
|
74
91
|
)
|
|
75
|
-
routed_experts = np.array([[[1]], [[2]]], dtype=np.uint8)
|
|
76
92
|
payload = {
|
|
77
93
|
"request_id": "gen-test",
|
|
78
|
-
"choices": [
|
|
79
|
-
{
|
|
80
|
-
"index": 0,
|
|
81
|
-
"token_ids": [7, 8],
|
|
82
|
-
"logprobs": {
|
|
83
|
-
"content": [
|
|
84
|
-
{"token": "token_id:7", "logprob": -0.1},
|
|
85
|
-
{"token": "token_id:8", "logprob": -0.2},
|
|
86
|
-
]
|
|
87
|
-
},
|
|
88
|
-
"finish_reason": "stop",
|
|
89
|
-
"routed_experts": {
|
|
90
|
-
"data": base64.b64encode(routed_experts.tobytes()).decode(
|
|
91
|
-
"ascii"
|
|
92
|
-
),
|
|
93
|
-
"shape": list(routed_experts.shape),
|
|
94
|
-
},
|
|
95
|
-
}
|
|
96
|
-
],
|
|
94
|
+
"choices": [self.choice],
|
|
97
95
|
}
|
|
98
96
|
return httpx.Response(
|
|
99
97
|
200,
|
|
@@ -101,6 +99,18 @@ class _FakeClient:
|
|
|
101
99
|
)
|
|
102
100
|
|
|
103
101
|
|
|
102
|
+
def _run_generate(client, renderer=None):
|
|
103
|
+
return asyncio.run(
|
|
104
|
+
generate(
|
|
105
|
+
client=client,
|
|
106
|
+
renderer=renderer or _FakeRenderer(),
|
|
107
|
+
messages=[{"role": "user", "content": "hi"}],
|
|
108
|
+
model="test-model",
|
|
109
|
+
tools=[{"type": "function", "function": {"name": "echo"}}],
|
|
110
|
+
)
|
|
111
|
+
)
|
|
112
|
+
|
|
113
|
+
|
|
104
114
|
def test_generate_builds_request_body_and_parses_response():
|
|
105
115
|
client = _FakeClient()
|
|
106
116
|
renderer = _FakeRenderer()
|
|
@@ -172,6 +182,95 @@ def test_generate_builds_request_body_and_parses_response():
|
|
|
172
182
|
assert tc.status == ToolCallParseStatus.OK
|
|
173
183
|
|
|
174
184
|
|
|
185
|
+
def test_generate_rejects_missing_completion_logprobs_before_parsing():
|
|
186
|
+
client = _FakeClient()
|
|
187
|
+
client.choice.pop("logprobs")
|
|
188
|
+
renderer = _FakeRenderer()
|
|
189
|
+
|
|
190
|
+
with pytest.raises(
|
|
191
|
+
MalformedGenerateResponseError,
|
|
192
|
+
match=r"choice\.logprobs must be an object",
|
|
193
|
+
):
|
|
194
|
+
_run_generate(client, renderer)
|
|
195
|
+
|
|
196
|
+
assert not hasattr(renderer, "_last_parse_tools")
|
|
197
|
+
|
|
198
|
+
|
|
199
|
+
@pytest.mark.parametrize(
|
|
200
|
+
"entry",
|
|
201
|
+
[
|
|
202
|
+
{"token": "token_id:7"},
|
|
203
|
+
{"token": "token_id:7", "logprob": None},
|
|
204
|
+
{"token": "token_id:7", "logprob": "-0.1"},
|
|
205
|
+
{"token": "token_id:7", "logprob": True},
|
|
206
|
+
],
|
|
207
|
+
ids=["missing", "null", "string", "boolean"],
|
|
208
|
+
)
|
|
209
|
+
def test_generate_rejects_non_numeric_completion_logprobs(entry):
|
|
210
|
+
client = _FakeClient()
|
|
211
|
+
client.choice["logprobs"]["content"][0] = entry
|
|
212
|
+
|
|
213
|
+
with pytest.raises(
|
|
214
|
+
MalformedGenerateResponseError,
|
|
215
|
+
match=r"content\[0\]\.logprob must be a number",
|
|
216
|
+
):
|
|
217
|
+
_run_generate(client)
|
|
218
|
+
|
|
219
|
+
|
|
220
|
+
def test_generate_rejects_completion_logprob_count_mismatch():
|
|
221
|
+
client = _FakeClient()
|
|
222
|
+
client.choice["logprobs"]["content"] = [{"token": "token_id:7", "logprob": -0.1}]
|
|
223
|
+
|
|
224
|
+
with pytest.raises(
|
|
225
|
+
MalformedGenerateResponseError,
|
|
226
|
+
match=r"completion token count \(2\) does not match logprob count \(1\)",
|
|
227
|
+
):
|
|
228
|
+
_run_generate(client)
|
|
229
|
+
|
|
230
|
+
|
|
231
|
+
@pytest.mark.parametrize("logprob", [float("nan"), float("inf"), float("-inf")])
|
|
232
|
+
def test_generate_rejects_non_finite_completion_logprobs(logprob):
|
|
233
|
+
client = _FakeClient()
|
|
234
|
+
client.choice["logprobs"]["content"][0]["logprob"] = logprob
|
|
235
|
+
|
|
236
|
+
with pytest.raises(
|
|
237
|
+
MalformedGenerateResponseError,
|
|
238
|
+
match=r"content\[0\]\.logprob must be finite",
|
|
239
|
+
):
|
|
240
|
+
_run_generate(client)
|
|
241
|
+
|
|
242
|
+
|
|
243
|
+
def test_generate_rejects_vllm_missing_logprob_sentinel():
|
|
244
|
+
client = _FakeClient()
|
|
245
|
+
client.choice["logprobs"]["content"][0]["logprob"] = -9999.0
|
|
246
|
+
|
|
247
|
+
with pytest.raises(
|
|
248
|
+
MalformedGenerateResponseError,
|
|
249
|
+
match=r"does not contain sampling evidence",
|
|
250
|
+
):
|
|
251
|
+
_run_generate(client)
|
|
252
|
+
|
|
253
|
+
|
|
254
|
+
def test_generate_rejects_logprob_token_id_mismatch():
|
|
255
|
+
client = _FakeClient()
|
|
256
|
+
client.choice["logprobs"]["content"][0]["token"] = "token_id:8"
|
|
257
|
+
|
|
258
|
+
with pytest.raises(
|
|
259
|
+
MalformedGenerateResponseError,
|
|
260
|
+
match=r"content\[0\]\.token must be 'token_id:7'",
|
|
261
|
+
):
|
|
262
|
+
_run_generate(client)
|
|
263
|
+
|
|
264
|
+
|
|
265
|
+
def test_generate_preserves_zero_completion_logprob():
|
|
266
|
+
client = _FakeClient()
|
|
267
|
+
client.choice["logprobs"]["content"][0]["logprob"] = 0.0
|
|
268
|
+
|
|
269
|
+
result = _run_generate(client)
|
|
270
|
+
|
|
271
|
+
assert result["completion_logprobs"] == [0.0, -0.2]
|
|
272
|
+
|
|
273
|
+
|
|
175
274
|
class _MalformedToolRenderer(_FakeRenderer):
|
|
176
275
|
"""Returns only a malformed tool-call attempt — finish_reason must stay "stop"."""
|
|
177
276
|
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|