renderers 0.1.9.dev4__tar.gz → 0.1.9.dev7__tar.gz

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (75) hide show
  1. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/.github/workflows/style.yml +8 -0
  2. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/PKG-INFO +1 -1
  3. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/__init__.py +2 -1
  4. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/_version.py +2 -2
  5. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/client.py +70 -5
  6. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_client.py +119 -20
  7. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/.github/workflows/publish-dev.yml +0 -0
  8. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/.github/workflows/publish.yml +0 -0
  9. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/.github/workflows/test.yml +0 -0
  10. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/.gitignore +0 -0
  11. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/.pre-commit-config.yaml +0 -0
  12. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/LICENSE +0 -0
  13. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/README.md +0 -0
  14. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/docs/renderer-config.md +0 -0
  15. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/examples/README.md +0 -0
  16. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/examples/sglang/multiturn_generate_sglang.py +0 -0
  17. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/examples/sglang/online_multiturn_sglang.py +0 -0
  18. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/examples/tinker/multiturn_generate_tinker.py +0 -0
  19. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/examples/transformers/multiturn_generate_transformers.py +0 -0
  20. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/examples/vllm/multiturn_generate_vllm.py +0 -0
  21. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/pyproject.toml +0 -0
  22. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/base.py +0 -0
  23. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/configs.py +0 -0
  24. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/deepseek_r1.py +0 -0
  25. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/deepseek_v3.py +0 -0
  26. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/default.py +0 -0
  27. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/glm45.py +0 -0
  28. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/glm5.py +0 -0
  29. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/gpt_oss.py +0 -0
  30. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/hy3.py +0 -0
  31. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/kimi_k2.py +0 -0
  32. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/kimi_k25.py +0 -0
  33. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/laguna_xs2.py +0 -0
  34. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/llama_3.py +0 -0
  35. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/minimax_m2.py +0 -0
  36. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/nemotron3.py +0 -0
  37. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/parsers.py +0 -0
  38. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/parsing.py +0 -0
  39. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/prime_qwen3.py +0 -0
  40. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/qwen3.py +0 -0
  41. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/qwen35.py +0 -0
  42. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/qwen36.py +0 -0
  43. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/renderers/qwen3_vl.py +0 -0
  44. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/conftest.py +0 -0
  45. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_bridge.py +0 -0
  46. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_build_helpers.py +0 -0
  47. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_deepseek_r1.py +0 -0
  48. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_disabled_thinking_stability.py +0 -0
  49. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_gpt_oss_harmony_parity.py +0 -0
  50. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_hy3.py +0 -0
  51. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_incremental.py +0 -0
  52. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_is_content.py +0 -0
  53. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_kimi_k25_tool_schema.py +0 -0
  54. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_laguna_xs21.py +0 -0
  55. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_llama_3.py +0 -0
  56. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_load_tokenizer.py +0 -0
  57. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_message_indices.py +0 -0
  58. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_message_tool_names.py +0 -0
  59. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_multimodal.py +0 -0
  60. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_nemotron3_parity.py +0 -0
  61. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_nemotron3_ultra.py +0 -0
  62. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_parse_response.py +0 -0
  63. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_parse_response_robustness.py +0 -0
  64. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_parsers.py +0 -0
  65. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_preserve_thinking.py +0 -0
  66. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_prime_qwen3_parity.py +0 -0
  67. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_qwen35_size_coverage.py +0 -0
  68. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_render_ids.py +0 -0
  69. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_renderer_config.py +0 -0
  70. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_renderer_config_parity.py +0 -0
  71. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_roundtrip.py +0 -0
  72. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_sampled_mask.py +0 -0
  73. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_tokens_per_message.py +0 -0
  74. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/tests/test_tool_arg_type_preservation.py +0 -0
  75. {renderers-0.1.9.dev4 → renderers-0.1.9.dev7}/uv.lock +0 -0
@@ -15,9 +15,17 @@ jobs:
15
15
  uses: actions/checkout@v4
16
16
  - name: Lint
17
17
  uses: astral-sh/ruff-action@v3
18
+ with:
19
+ # Pin the ruff version so CI matches what contributors resolve
20
+ # locally. ruff-action defaults to the latest release, which drifts
21
+ # (e.g. 0.16.0 enabled stricter rules that flag pre-existing code)
22
+ # and turns green PRs red without any code change. Bump this
23
+ # deliberately alongside any lint fixes.
24
+ version: "0.15.12"
18
25
  - name: Format
19
26
  uses: astral-sh/ruff-action@v3
20
27
  with:
28
+ version: "0.15.12"
21
29
  args: "format --check"
22
30
  ty:
23
31
  name: Ty
@@ -1,6 +1,6 @@
1
1
  Metadata-Version: 2.4
2
2
  Name: renderers
3
- Version: 0.1.9.dev4
3
+ Version: 0.1.9.dev7
4
4
  Summary: Chat template renderers — deterministic message-to-token conversion for LLM training
5
5
  License-Expression: Apache-2.0
6
6
  License-File: LICENSE
@@ -39,7 +39,7 @@ from renderers.base import (
39
39
  reject_assistant_in_extension,
40
40
  trim_to_turn_close,
41
41
  )
42
- from renderers.client import OverlongPromptError
42
+ from renderers.client import MalformedGenerateResponseError, OverlongPromptError
43
43
  from renderers.configs import (
44
44
  AutoRendererConfig,
45
45
  BaseRendererConfig,
@@ -152,6 +152,7 @@ __all__ = [
152
152
  "Llama3Renderer",
153
153
  "Llama3RendererConfig",
154
154
  "MULTIMODAL_MODELS",
155
+ "MalformedGenerateResponseError",
155
156
  "Message",
156
157
  "MiniMaxM2Renderer",
157
158
  "MiniMaxM2RendererConfig",
@@ -18,7 +18,7 @@ version_tuple: tuple[int | str, ...]
18
18
  commit_id: str | None
19
19
  __commit_id__: str | None
20
20
 
21
- __version__ = version = '0.1.9.dev4'
22
- __version_tuple__ = version_tuple = (0, 1, 9, 'dev4')
21
+ __version__ = version = '0.1.9.dev7'
22
+ __version_tuple__ = version_tuple = (0, 1, 9, 'dev7')
23
23
 
24
24
  __commit_id__ = commit_id = None
@@ -14,6 +14,7 @@ from __future__ import annotations
14
14
  import asyncio
15
15
  import json
16
16
  import logging
17
+ import math
17
18
  from collections.abc import Mapping
18
19
  from typing import Any, cast
19
20
 
@@ -33,6 +34,9 @@ from renderers.base import (
33
34
  _request_logger = logging.getLogger("renderers.client")
34
35
  ROUTED_EXPERTS_DATA_PREFIX = b'"routed_experts":{"data":"'
35
36
  KEPT_TOKENS_IDS_PREFIX = b'"kept_tokens":{"ids":"'
37
+ # vLLM uses this value both when sampled-token evidence is missing and as a
38
+ # lower-bound clamp, so receiving it cannot prove the real logprob was returned.
39
+ VLLM_LOGPROB_SENTINEL = -9999.0
36
40
 
37
41
 
38
42
  class OverlongPromptError(Exception):
@@ -59,6 +63,10 @@ class OverlongPromptError(Exception):
59
63
  )
60
64
 
61
65
 
66
+ class MalformedGenerateResponseError(ValueError):
67
+ """The generate endpoint returned unusable sampled-token evidence."""
68
+
69
+
62
70
  # Per-process cache of resolved engine context-length caps, keyed by
63
71
  # ``(base_url, model)``. ``None`` is the "we asked the engine and it didn't
64
72
  # tell us" sentinel — distinct from "key missing" (haven't asked yet). The
@@ -150,6 +158,66 @@ def parse_generate_response(raw: bytes) -> dict[str, Any]:
150
158
  return payload
151
159
 
152
160
 
161
+ def _parse_completion_logprobs(
162
+ choice: Mapping[str, Any], completion_ids: list[int]
163
+ ) -> list[float]:
164
+ raw_logprobs = choice.get("logprobs")
165
+ if not isinstance(raw_logprobs, Mapping):
166
+ raise MalformedGenerateResponseError(
167
+ "Engine response choice.logprobs must be an object."
168
+ )
169
+
170
+ content = raw_logprobs.get("content")
171
+ if not isinstance(content, list):
172
+ raise MalformedGenerateResponseError(
173
+ "Engine response choice.logprobs.content must be a list."
174
+ )
175
+ if len(content) != len(completion_ids):
176
+ raise MalformedGenerateResponseError(
177
+ "Engine response completion token count "
178
+ f"({len(completion_ids)}) does not match logprob count ({len(content)})."
179
+ )
180
+
181
+ completion_logprobs: list[float] = []
182
+ for index, entry in enumerate(content):
183
+ if not isinstance(entry, Mapping):
184
+ raise MalformedGenerateResponseError(
185
+ f"Engine response choice.logprobs.content[{index}] must be an object."
186
+ )
187
+ expected_token = f"token_id:{completion_ids[index]}"
188
+ if entry.get("token") != expected_token:
189
+ raise MalformedGenerateResponseError(
190
+ "Engine response "
191
+ f"choice.logprobs.content[{index}].token must be {expected_token!r}."
192
+ )
193
+ raw_logprob = entry.get("logprob")
194
+ if isinstance(raw_logprob, bool) or not isinstance(raw_logprob, (int, float)):
195
+ raise MalformedGenerateResponseError(
196
+ "Engine response "
197
+ f"choice.logprobs.content[{index}].logprob must be a number."
198
+ )
199
+ try:
200
+ logprob = float(raw_logprob)
201
+ except OverflowError as exc:
202
+ raise MalformedGenerateResponseError(
203
+ "Engine response "
204
+ f"choice.logprobs.content[{index}].logprob must be finite."
205
+ ) from exc
206
+ if not math.isfinite(logprob):
207
+ raise MalformedGenerateResponseError(
208
+ "Engine response "
209
+ f"choice.logprobs.content[{index}].logprob must be finite."
210
+ )
211
+ if logprob == VLLM_LOGPROB_SENTINEL:
212
+ raise MalformedGenerateResponseError(
213
+ "Engine response "
214
+ f"choice.logprobs.content[{index}].logprob does not contain "
215
+ "sampling evidence."
216
+ )
217
+ completion_logprobs.append(logprob)
218
+ return completion_logprobs
219
+
220
+
153
221
  async def generate(
154
222
  *,
155
223
  client: AsyncOpenAI,
@@ -292,15 +360,12 @@ async def generate(
292
360
  choice = (data.get("choices") or [{}])[0]
293
361
  completion_ids = choice.get("token_ids") or []
294
362
 
363
+ completion_logprobs = _parse_completion_logprobs(choice, completion_ids)
364
+
295
365
  parsed = await _maybe_offload(
296
366
  renderer, lambda: renderer.parse_response(completion_ids, tools=tools)
297
367
  )
298
368
 
299
- # ChatCompletionLogProbs flatten: {"content": [{"logprob": ...}, ...]}
300
- raw_logprobs = choice.get("logprobs") or {}
301
- content_lp = raw_logprobs.get("content") if isinstance(raw_logprobs, dict) else None
302
- completion_logprobs = [float(c.get("logprob") or 0.0) for c in content_lp or []]
303
-
304
369
  routed_experts = choice.get("routed_experts")
305
370
  kept_tokens = choice.get("kept_tokens")
306
371
 
@@ -5,6 +5,7 @@ import json
5
5
  import httpx
6
6
  import numpy as np
7
7
  import pytest
8
+ from renderers import MalformedGenerateResponseError
8
9
  from renderers.base import (
9
10
  ParsedResponse,
10
11
  ParsedToolCall,
@@ -67,33 +68,30 @@ class _FakeClient:
67
68
  def __init__(self):
68
69
  self.calls = []
69
70
  self.base_url = "http://fake-host:8000/v1"
71
+ routed_experts = np.array([[[1]], [[2]]], dtype=np.uint8)
72
+ self.choice = {
73
+ "index": 0,
74
+ "token_ids": [7, 8],
75
+ "logprobs": {
76
+ "content": [
77
+ {"token": "token_id:7", "logprob": -0.1},
78
+ {"token": "token_id:8", "logprob": -0.2},
79
+ ]
80
+ },
81
+ "finish_reason": "stop",
82
+ "routed_experts": {
83
+ "data": base64.b64encode(routed_experts.tobytes()).decode("ascii"),
84
+ "shape": list(routed_experts.shape),
85
+ },
86
+ }
70
87
 
71
88
  async def post(self, path, *, cast_to=dict, body=None, options=None):
72
89
  self.calls.append(
73
90
  {"path": path, "cast_to": cast_to, "body": body, "options": options}
74
91
  )
75
- routed_experts = np.array([[[1]], [[2]]], dtype=np.uint8)
76
92
  payload = {
77
93
  "request_id": "gen-test",
78
- "choices": [
79
- {
80
- "index": 0,
81
- "token_ids": [7, 8],
82
- "logprobs": {
83
- "content": [
84
- {"token": "token_id:7", "logprob": -0.1},
85
- {"token": "token_id:8", "logprob": -0.2},
86
- ]
87
- },
88
- "finish_reason": "stop",
89
- "routed_experts": {
90
- "data": base64.b64encode(routed_experts.tobytes()).decode(
91
- "ascii"
92
- ),
93
- "shape": list(routed_experts.shape),
94
- },
95
- }
96
- ],
94
+ "choices": [self.choice],
97
95
  }
98
96
  return httpx.Response(
99
97
  200,
@@ -101,6 +99,18 @@ class _FakeClient:
101
99
  )
102
100
 
103
101
 
102
+ def _run_generate(client, renderer=None):
103
+ return asyncio.run(
104
+ generate(
105
+ client=client,
106
+ renderer=renderer or _FakeRenderer(),
107
+ messages=[{"role": "user", "content": "hi"}],
108
+ model="test-model",
109
+ tools=[{"type": "function", "function": {"name": "echo"}}],
110
+ )
111
+ )
112
+
113
+
104
114
  def test_generate_builds_request_body_and_parses_response():
105
115
  client = _FakeClient()
106
116
  renderer = _FakeRenderer()
@@ -172,6 +182,95 @@ def test_generate_builds_request_body_and_parses_response():
172
182
  assert tc.status == ToolCallParseStatus.OK
173
183
 
174
184
 
185
+ def test_generate_rejects_missing_completion_logprobs_before_parsing():
186
+ client = _FakeClient()
187
+ client.choice.pop("logprobs")
188
+ renderer = _FakeRenderer()
189
+
190
+ with pytest.raises(
191
+ MalformedGenerateResponseError,
192
+ match=r"choice\.logprobs must be an object",
193
+ ):
194
+ _run_generate(client, renderer)
195
+
196
+ assert not hasattr(renderer, "_last_parse_tools")
197
+
198
+
199
+ @pytest.mark.parametrize(
200
+ "entry",
201
+ [
202
+ {"token": "token_id:7"},
203
+ {"token": "token_id:7", "logprob": None},
204
+ {"token": "token_id:7", "logprob": "-0.1"},
205
+ {"token": "token_id:7", "logprob": True},
206
+ ],
207
+ ids=["missing", "null", "string", "boolean"],
208
+ )
209
+ def test_generate_rejects_non_numeric_completion_logprobs(entry):
210
+ client = _FakeClient()
211
+ client.choice["logprobs"]["content"][0] = entry
212
+
213
+ with pytest.raises(
214
+ MalformedGenerateResponseError,
215
+ match=r"content\[0\]\.logprob must be a number",
216
+ ):
217
+ _run_generate(client)
218
+
219
+
220
+ def test_generate_rejects_completion_logprob_count_mismatch():
221
+ client = _FakeClient()
222
+ client.choice["logprobs"]["content"] = [{"token": "token_id:7", "logprob": -0.1}]
223
+
224
+ with pytest.raises(
225
+ MalformedGenerateResponseError,
226
+ match=r"completion token count \(2\) does not match logprob count \(1\)",
227
+ ):
228
+ _run_generate(client)
229
+
230
+
231
+ @pytest.mark.parametrize("logprob", [float("nan"), float("inf"), float("-inf")])
232
+ def test_generate_rejects_non_finite_completion_logprobs(logprob):
233
+ client = _FakeClient()
234
+ client.choice["logprobs"]["content"][0]["logprob"] = logprob
235
+
236
+ with pytest.raises(
237
+ MalformedGenerateResponseError,
238
+ match=r"content\[0\]\.logprob must be finite",
239
+ ):
240
+ _run_generate(client)
241
+
242
+
243
+ def test_generate_rejects_vllm_missing_logprob_sentinel():
244
+ client = _FakeClient()
245
+ client.choice["logprobs"]["content"][0]["logprob"] = -9999.0
246
+
247
+ with pytest.raises(
248
+ MalformedGenerateResponseError,
249
+ match=r"does not contain sampling evidence",
250
+ ):
251
+ _run_generate(client)
252
+
253
+
254
+ def test_generate_rejects_logprob_token_id_mismatch():
255
+ client = _FakeClient()
256
+ client.choice["logprobs"]["content"][0]["token"] = "token_id:8"
257
+
258
+ with pytest.raises(
259
+ MalformedGenerateResponseError,
260
+ match=r"content\[0\]\.token must be 'token_id:7'",
261
+ ):
262
+ _run_generate(client)
263
+
264
+
265
+ def test_generate_preserves_zero_completion_logprob():
266
+ client = _FakeClient()
267
+ client.choice["logprobs"]["content"][0]["logprob"] = 0.0
268
+
269
+ result = _run_generate(client)
270
+
271
+ assert result["completion_logprobs"] == [0.0, -0.2]
272
+
273
+
175
274
  class _MalformedToolRenderer(_FakeRenderer):
176
275
  """Returns only a malformed tool-call attempt — finish_reason must stay "stop"."""
177
276
 
File without changes
File without changes
File without changes