PyPI - synth-ai - Versions diffs - 0.2.9.dev11__py3-none-any.whl → 0.4.1__py3-none-any.whl - Mend

synth-ai 0.2.9.dev11py3-none-any.whl → 0.4.1py3-none-any.whl

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.

Potentially problematic release.

This version of synth-ai might be problematic. Click here for more details.

Files changed (909) hide show

synth_ai/__init__.py +44 -45
synth_ai/__main__.py +30 -3
synth_ai/cli/__init__.py +104 -78
synth_ai/cli/__main__.py +42 -0
synth_ai/cli/_internal/__init__.py +5 -0
synth_ai/cli/_internal/modal_wrapper.py +31 -0
synth_ai/cli/_internal/storage.py +20 -0
synth_ai/cli/_internal/typer_patch.py +47 -0
synth_ai/cli/_internal/validate_task_app.py +29 -0
synth_ai/cli/agents/__init__.py +17 -0
synth_ai/cli/agents/claude.py +77 -0
synth_ai/cli/agents/codex.py +265 -0
synth_ai/cli/agents/opencode.py +253 -0
synth_ai/cli/commands/__init__.py +18 -0
synth_ai/cli/commands/artifacts/__init__.py +13 -0
synth_ai/cli/commands/artifacts/client.py +119 -0
synth_ai/cli/commands/artifacts/config.py +57 -0
synth_ai/cli/commands/artifacts/core.py +24 -0
synth_ai/cli/commands/artifacts/download.py +188 -0
synth_ai/cli/commands/artifacts/export.py +186 -0
synth_ai/cli/commands/artifacts/list.py +156 -0
synth_ai/cli/commands/artifacts/parsing.py +250 -0
synth_ai/cli/commands/artifacts/show.py +336 -0
synth_ai/cli/commands/baseline/__init__.py +12 -0
synth_ai/cli/commands/baseline/core.py +636 -0
synth_ai/cli/commands/baseline/list.py +94 -0
synth_ai/cli/commands/demo/__init__.py +3 -0
synth_ai/cli/commands/demo/core.py +153 -0
synth_ai/cli/commands/eval/__init__.py +19 -0
synth_ai/cli/commands/eval/core.py +1113 -0
synth_ai/cli/commands/eval/errors.py +81 -0
synth_ai/cli/commands/eval/validation.py +133 -0
synth_ai/cli/commands/filter/__init__.py +12 -0
synth_ai/cli/commands/filter/core.py +424 -0
synth_ai/cli/commands/filter/errors.py +55 -0
synth_ai/cli/commands/filter/validation.py +77 -0
synth_ai/cli/commands/help/__init__.py +185 -0
synth_ai/cli/commands/help/core.py +72 -0
synth_ai/cli/commands/scan/__init__.py +19 -0
synth_ai/cli/commands/scan/cloudflare_scanner.py +403 -0
synth_ai/cli/commands/scan/core.py +344 -0
synth_ai/cli/commands/scan/health_checker.py +242 -0
synth_ai/cli/commands/scan/local_scanner.py +278 -0
synth_ai/cli/commands/scan/models.py +83 -0
synth_ai/cli/commands/smoke/__init__.py +7 -0
synth_ai/cli/commands/smoke/core.py +1438 -0
synth_ai/cli/commands/status/__init__.py +66 -0
synth_ai/cli/commands/status/client.py +192 -0
synth_ai/cli/commands/status/config.py +92 -0
synth_ai/cli/commands/status/errors.py +20 -0
synth_ai/cli/commands/status/formatters.py +164 -0
synth_ai/cli/commands/status/subcommands/__init__.py +9 -0
synth_ai/cli/commands/status/subcommands/files.py +79 -0
synth_ai/cli/commands/status/subcommands/jobs.py +334 -0
synth_ai/cli/commands/status/subcommands/models.py +79 -0
synth_ai/cli/commands/status/subcommands/pricing.py +23 -0
synth_ai/cli/commands/status/subcommands/runs.py +81 -0
synth_ai/cli/commands/status/subcommands/session.py +182 -0
synth_ai/cli/commands/status/subcommands/summary.py +47 -0
synth_ai/cli/commands/status/subcommands/usage.py +203 -0
synth_ai/cli/commands/status/utils.py +114 -0
synth_ai/cli/commands/train/__init__.py +53 -0
synth_ai/cli/commands/train/core.py +22 -0
synth_ai/cli/commands/train/errors.py +117 -0
synth_ai/cli/commands/train/judge_schemas.py +201 -0
synth_ai/cli/commands/train/judge_validation.py +305 -0
synth_ai/cli/commands/train/prompt_learning_validation.py +633 -0
synth_ai/cli/commands/train/validation.py +392 -0
synth_ai/cli/demo_apps/__init__.py +10 -0
synth_ai/cli/demo_apps/core/__init__.py +28 -0
synth_ai/cli/demo_apps/core/cli.py +1735 -0
synth_ai/cli/demo_apps/crafter/crafter_fft_4b.toml +55 -0
synth_ai/cli/demo_apps/crafter/grpo_crafter_task_app.py +186 -0
synth_ai/cli/demo_apps/crafter/rl_from_base_qwen4b.toml +74 -0
synth_ai/cli/demo_apps/demo_registry.py +176 -0
synth_ai/cli/demo_apps/demo_task_apps/core.py +440 -0
synth_ai/cli/demo_apps/demo_task_apps/crafter/__init__.py +1 -0
synth_ai/cli/demo_apps/demo_task_apps/crafter/grpo_crafter_task_app.py +185 -0
synth_ai/cli/demo_apps/demo_task_apps/math/modal_task_app.py +742 -0
synth_ai/cli/demo_apps/demo_task_apps/math/task_app_entry.py +39 -0
synth_ai/cli/demo_apps/math/__init__.py +1 -0
synth_ai/cli/demo_apps/math/_common.py +16 -0
synth_ai/cli/demo_apps/math/app.py +38 -0
synth_ai/cli/demo_apps/math/config.toml +76 -0
synth_ai/cli/demo_apps/math/deploy_modal.py +54 -0
synth_ai/cli/demo_apps/math/modal_task_app.py +702 -0
synth_ai/cli/demo_apps/math/task_app_entry.py +53 -0
synth_ai/cli/demo_apps/mipro/main.py +271 -0
synth_ai/cli/demo_apps/mipro/task_app.py +933 -0
synth_ai/cli/demo_apps/mipro/train_cfg.toml +92 -0
synth_ai/cli/demos/__init__.py +12 -0
synth_ai/cli/demos/demo.py +32 -0
synth_ai/cli/demos/rl_demo.py +254 -0
synth_ai/cli/deploy.py +216 -0
synth_ai/cli/infra/__init__.py +14 -0
synth_ai/cli/infra/balance.py +216 -0
synth_ai/cli/infra/mcp.py +35 -0
synth_ai/cli/infra/modal_app.py +36 -0
synth_ai/cli/infra/setup.py +69 -0
synth_ai/cli/infra/status.py +16 -0
synth_ai/cli/infra/turso.py +77 -0
synth_ai/cli/lib/__init__.py +10 -0
synth_ai/cli/lib/agents.py +76 -0
synth_ai/cli/lib/apps/modal_app.py +101 -0
synth_ai/cli/lib/apps/task_app.py +643 -0
synth_ai/cli/lib/bin.py +39 -0
synth_ai/cli/lib/env.py +375 -0
synth_ai/cli/lib/errors.py +85 -0
synth_ai/cli/lib/modal.py +315 -0
synth_ai/cli/lib/plotting.py +126 -0
synth_ai/cli/lib/prompt_args.py +39 -0
synth_ai/cli/lib/prompts.py +284 -0
synth_ai/cli/lib/sqld.py +122 -0
synth_ai/cli/lib/task_app_discovery.py +884 -0
synth_ai/cli/lib/task_app_env.py +295 -0
synth_ai/cli/lib/train_cfgs.py +300 -0
synth_ai/cli/lib/tunnel_records.py +207 -0
synth_ai/cli/local/__init__.py +14 -0
synth_ai/cli/local/experiment_queue/__init__.py +72 -0
synth_ai/cli/local/experiment_queue/api_schemas.py +221 -0
synth_ai/cli/local/experiment_queue/celery_app.py +208 -0
synth_ai/cli/local/experiment_queue/config.py +128 -0
synth_ai/cli/local/experiment_queue/config_utils.py +272 -0
synth_ai/cli/local/experiment_queue/database.py +175 -0
synth_ai/cli/local/experiment_queue/dispatcher.py +119 -0
synth_ai/cli/local/experiment_queue/models.py +231 -0
synth_ai/cli/local/experiment_queue/progress_info.py +160 -0
synth_ai/cli/local/experiment_queue/results.py +373 -0
synth_ai/cli/local/experiment_queue/schemas.py +131 -0
synth_ai/cli/local/experiment_queue/service.py +344 -0
synth_ai/cli/local/experiment_queue/status.py +372 -0
synth_ai/cli/local/experiment_queue/status_tracker.py +360 -0
synth_ai/cli/local/experiment_queue/tasks.py +1984 -0
synth_ai/cli/local/experiment_queue/trace_storage.py +65 -0
synth_ai/cli/local/experiment_queue/validation.py +157 -0
synth_ai/cli/local/session/__init__.py +92 -0
synth_ai/cli/local/session/client.py +383 -0
synth_ai/cli/local/session/constants.py +63 -0
synth_ai/cli/local/session/exceptions.py +105 -0
synth_ai/cli/local/session/manager.py +139 -0
synth_ai/cli/local/session/models.py +89 -0
synth_ai/cli/local/session/query.py +110 -0
synth_ai/cli/root.py +30 -103
synth_ai/cli/task_apps/__init__.py +26 -0
synth_ai/cli/task_apps/commands.py +3153 -0
synth_ai/cli/task_apps/deploy.py +7 -0
synth_ai/cli/task_apps/list.py +26 -0
synth_ai/cli/task_apps/main.py +36 -0
synth_ai/cli/task_apps/modal_serve.py +11 -0
synth_ai/cli/task_apps/serve.py +11 -0
synth_ai/cli/training/__init__.py +8 -0
synth_ai/cli/training/train.py +5 -0
synth_ai/cli/training/train_cfg.py +34 -0
synth_ai/cli/training/watch.py +506 -0
synth_ai/cli/turso.py +34 -55
synth_ai/cli/usage.py +159 -0
synth_ai/cli/utils/__init__.py +8 -0
synth_ai/cli/utils/experiments.py +235 -0
synth_ai/cli/utils/queue.py +504 -0
synth_ai/cli/utils/recent.py +133 -0
synth_ai/cli/utils/traces.py +164 -0
synth_ai/contracts/__init__.py +67 -0
synth_ai/core/__init__.py +100 -0
synth_ai/core/_utils/__init__.py +54 -0
synth_ai/core/_utils/base_url.py +10 -0
synth_ai/core/_utils/http.py +10 -0
synth_ai/core/_utils/prompts.py +14 -0
synth_ai/core/_utils/task_app_state.py +12 -0
synth_ai/core/_utils/user_config.py +10 -0
synth_ai/core/apps/common.py +116 -0
synth_ai/core/auth.py +95 -0
synth_ai/core/cfgs.py +240 -0
synth_ai/core/config/__init__.py +16 -0
synth_ai/core/config/base.py +168 -0
synth_ai/core/config/resolver.py +89 -0
synth_ai/core/env.py +220 -0
synth_ai/core/errors.py +126 -0
synth_ai/core/http.py +230 -0
synth_ai/core/integrations/__init__.py +11 -0
synth_ai/core/integrations/cloudflare.py +1710 -0
synth_ai/core/integrations/mcp/__init__.py +6 -0
synth_ai/core/integrations/mcp/__main__.py +8 -0
synth_ai/core/integrations/mcp/claude.py +36 -0
synth_ai/core/integrations/mcp/main.py +254 -0
synth_ai/core/integrations/mcp/setup.py +100 -0
synth_ai/core/integrations/modal.py +277 -0
synth_ai/core/json.py +72 -0
synth_ai/core/log_filter.py +99 -0
synth_ai/core/logging.py +82 -0
synth_ai/core/paths.py +107 -0
synth_ai/core/pricing.py +109 -0
synth_ai/core/process.py +233 -0
synth_ai/core/ssl.py +25 -0
synth_ai/core/storage/__init__.py +71 -0
synth_ai/core/task_app_state.py +318 -0
synth_ai/core/telemetry.py +282 -0
synth_ai/core/tracing_v3/__init__.py +99 -0
synth_ai/core/tracing_v3/config.py +229 -0
synth_ai/core/tracing_v3/constants.py +21 -0
synth_ai/core/tracing_v3/db_config.py +182 -0
synth_ai/core/tracing_v3/decorators.py +401 -0
synth_ai/core/tracing_v3/examples/basic_usage.py +194 -0
synth_ai/core/tracing_v3/llm_call_record_helpers.py +437 -0
synth_ai/core/tracing_v3/migration_helper.py +119 -0
synth_ai/core/tracing_v3/replica_sync.py +262 -0
synth_ai/core/tracing_v3/serialization.py +130 -0
synth_ai/core/tracing_v3/session_tracer.py +542 -0
synth_ai/core/tracing_v3/storage/base.py +211 -0
synth_ai/core/tracing_v3/storage/config.py +109 -0
synth_ai/core/tracing_v3/storage/factory.py +39 -0
synth_ai/core/tracing_v3/storage/utils.py +206 -0
synth_ai/core/tracing_v3/trace_utils.py +326 -0
synth_ai/core/tracing_v3/turso/__init__.py +12 -0
synth_ai/core/tracing_v3/turso/daemon.py +278 -0
synth_ai/core/tracing_v3/turso/models.py +470 -0
synth_ai/core/tracing_v3/turso/native_manager.py +1385 -0
synth_ai/core/tracing_v3/utils.py +108 -0
synth_ai/core/urls.py +18 -0
synth_ai/core/user_config.py +137 -0
synth_ai/core/uvicorn.py +222 -0
synth_ai/data/__init__.py +110 -0
synth_ai/data/enums.py +141 -0
synth_ai/data/rewards.py +152 -0
synth_ai/data/specs.py +36 -0
synth_ai/data/traces.py +35 -0
synth_ai/products/__init__.py +6 -0
synth_ai/products/graph_evolve/__init__.py +46 -0
synth_ai/products/graph_evolve/client.py +226 -0
synth_ai/products/graph_evolve/config.py +591 -0
synth_ai/products/graph_evolve/converters/__init__.py +42 -0
synth_ai/products/graph_evolve/converters/openai_sft.py +484 -0
synth_ai/products/graph_evolve/examples/hotpotqa/config.toml +109 -0
synth_ai/products/graph_evolve/run.py +222 -0
synth_ai/sdk/__init__.py +119 -0
synth_ai/sdk/api/__init__.py +1 -0
synth_ai/sdk/api/models/supported.py +514 -0
synth_ai/sdk/api/research_agent/__init__.py +86 -0
synth_ai/sdk/api/research_agent/cli.py +428 -0
synth_ai/sdk/api/research_agent/config.py +357 -0
synth_ai/sdk/api/research_agent/job.py +717 -0
synth_ai/sdk/api/train/__init__.py +85 -0
synth_ai/sdk/api/train/builders.py +895 -0
synth_ai/sdk/api/train/cli.py +2188 -0
synth_ai/sdk/api/train/config_finder.py +267 -0
synth_ai/sdk/api/train/configs/__init__.py +65 -0
synth_ai/sdk/api/train/configs/prompt_learning.py +1706 -0
synth_ai/sdk/api/train/configs/rl.py +188 -0
synth_ai/sdk/api/train/configs/sft.py +99 -0
synth_ai/sdk/api/train/configs/shared.py +81 -0
synth_ai/sdk/api/train/context_learning.py +312 -0
synth_ai/sdk/api/train/env_resolver.py +418 -0
synth_ai/sdk/api/train/graph_validators.py +216 -0
synth_ai/sdk/api/train/graphgen.py +984 -0
synth_ai/sdk/api/train/graphgen_models.py +823 -0
synth_ai/sdk/api/train/graphgen_validators.py +109 -0
synth_ai/sdk/api/train/pollers.py +124 -0
synth_ai/sdk/api/train/progress/__init__.py +97 -0
synth_ai/sdk/api/train/progress/dataclasses.py +569 -0
synth_ai/sdk/api/train/progress/events.py +326 -0
synth_ai/sdk/api/train/progress/results.py +428 -0
synth_ai/sdk/api/train/progress/tracker.py +641 -0
synth_ai/sdk/api/train/prompt_learning.py +470 -0
synth_ai/sdk/api/train/rl.py +442 -0
synth_ai/sdk/api/train/sft.py +396 -0
synth_ai/sdk/api/train/summary.py +522 -0
synth_ai/sdk/api/train/supported_algos.py +147 -0
synth_ai/sdk/api/train/task_app.py +331 -0
synth_ai/sdk/api/train/utils.py +279 -0
synth_ai/sdk/api/train/validators.py +2424 -0
synth_ai/sdk/baseline/__init__.py +25 -0
synth_ai/sdk/baseline/config.py +209 -0
synth_ai/sdk/baseline/discovery.py +216 -0
synth_ai/sdk/baseline/execution.py +154 -0
synth_ai/sdk/graphs/__init__.py +15 -0
synth_ai/sdk/graphs/completions.py +570 -0
synth_ai/sdk/inference/__init__.py +6 -0
synth_ai/sdk/inference/client.py +128 -0
synth_ai/sdk/jobs/__init__.py +16 -0
synth_ai/sdk/jobs/client.py +371 -0
synth_ai/sdk/judging/__init__.py +15 -0
synth_ai/sdk/judging/base.py +24 -0
synth_ai/sdk/judging/client.py +191 -0
synth_ai/sdk/judging/schemas.py +222 -0
synth_ai/sdk/judging/types.py +42 -0
synth_ai/sdk/learning/__init__.py +69 -0
synth_ai/sdk/learning/client.py +240 -0
synth_ai/sdk/learning/ft_client.py +7 -0
synth_ai/sdk/learning/health.py +49 -0
synth_ai/sdk/learning/jobs.py +202 -0
synth_ai/sdk/learning/prompt_extraction.py +334 -0
synth_ai/sdk/learning/prompt_learning_client.py +455 -0
synth_ai/sdk/learning/prompt_learning_types.py +185 -0
synth_ai/sdk/learning/rl/client.py +268 -0
synth_ai/sdk/learning/rl/contracts.py +27 -0
synth_ai/sdk/learning/rl/env_keys.py +166 -0
synth_ai/sdk/learning/rl/secrets.py +13 -0
synth_ai/sdk/learning/sft/client.py +95 -0
synth_ai/sdk/learning/sft/config.py +270 -0
synth_ai/sdk/learning/sft/data.py +698 -0
synth_ai/sdk/learning/validators.py +52 -0
synth_ai/sdk/research_agent/__init__.py +34 -0
synth_ai/sdk/research_agent/container_builder.py +328 -0
synth_ai/sdk/research_agent/container_spec.py +198 -0
synth_ai/sdk/research_agent/defaults.py +34 -0
synth_ai/sdk/research_agent/results_collector.py +69 -0
synth_ai/sdk/specs/__init__.py +46 -0
synth_ai/sdk/specs/dataclasses.py +149 -0
synth_ai/sdk/specs/loader.py +144 -0
synth_ai/sdk/specs/serializer.py +199 -0
synth_ai/sdk/specs/validation.py +250 -0
synth_ai/sdk/streaming/__init__.py +35 -0
synth_ai/sdk/streaming/config.py +94 -0
synth_ai/sdk/streaming/handlers.py +1997 -0
synth_ai/sdk/streaming/streamer.py +704 -0
synth_ai/sdk/streaming/types.py +112 -0
synth_ai/sdk/task/__init__.py +151 -0
synth_ai/sdk/task/apps/__init__.py +133 -0
synth_ai/sdk/task/config.py +261 -0
synth_ai/sdk/task/contracts.py +298 -0
synth_ai/sdk/task/datasets.py +108 -0
synth_ai/sdk/task/in_process.py +1190 -0
synth_ai/sdk/task/in_process_runner.py +309 -0
synth_ai/sdk/task/inference_api.py +299 -0
synth_ai/sdk/task/proxy.py +287 -0
synth_ai/sdk/task/rubrics/__init__.py +55 -0
synth_ai/sdk/task/rubrics/loaders.py +156 -0
synth_ai/sdk/task/rubrics/models.py +57 -0
synth_ai/sdk/task/rubrics/scoring.py +116 -0
synth_ai/sdk/task/rubrics/strict.py +149 -0
synth_ai/sdk/task/server.py +580 -0
synth_ai/sdk/task/trace_correlation_helpers.py +506 -0
synth_ai/sdk/task/tracing_utils.py +95 -0
synth_ai/sdk/task/validators.py +456 -0
synth_ai/sdk/tracing/__init__.py +39 -0
synth_ai/sdk/training/__init__.py +102 -0
synth_ai/sdk/usage/__init__.py +37 -0
synth_ai/sdk/usage/client.py +171 -0
synth_ai/sdk/usage/models.py +261 -0
synth_ai/utils/__init__.py +213 -0
synth_ai-0.4.1.dist-info/METADATA +195 -0
synth_ai-0.4.1.dist-info/RECORD +379 -0
synth_ai-0.4.1.dist-info/entry_points.txt +2 -0
synth_ai-0.4.1.dist-info/top_level.txt +1 -0
examples/__init__.py +0 -16
examples/analyze_semantic_words.sh +0 -17
examples/crafter_debug_render.py +0 -186
examples/qwen_coder/README.md +0 -102
examples/qwen_coder/_shared.py +0 -113
examples/qwen_coder/configs/coder_lora_30b.toml +0 -61
examples/qwen_coder/configs/coder_lora_4b.toml +0 -57
examples/qwen_coder/configs/coder_lora_small.toml +0 -58
examples/qwen_coder/generate_dataset.py +0 -98
examples/qwen_coder/infer_ft_smoke.py +0 -64
examples/qwen_coder/infer_prod_proxy.py +0 -73
examples/qwen_coder/infer_via_synth.py +0 -87
examples/qwen_coder/scripts/infer_coder.sh +0 -18
examples/qwen_coder/scripts/train_coder_30b.sh +0 -21
examples/qwen_coder/sft_full_17b.py +0 -103
examples/qwen_coder/sft_lora_30b.py +0 -110
examples/qwen_coder/subset_jsonl.py +0 -38
examples/qwen_coder/validate_jsonl.py +0 -59
examples/rl/README.md +0 -169
examples/rl/configs/eval_base_qwen.toml +0 -15
examples/rl/configs/eval_rl_qwen.toml +0 -11
examples/rl/configs/rl_from_base_qwen.toml +0 -35
examples/rl/configs/rl_from_base_qwen17.toml +0 -74
examples/rl/configs/rl_from_ft_qwen.toml +0 -35
examples/rl/download_dataset.py +0 -80
examples/rl/run_eval.py +0 -436
examples/rl/run_rl_and_save.py +0 -111
examples/rl/task_app/README.md +0 -22
examples/rl/task_app/math_single_step.py +0 -991
examples/rl/task_app/math_task_app.py +0 -115
examples/run_crafter_demo.sh +0 -10
examples/sft/README.md +0 -139
examples/sft/configs/crafter_fft_qwen0p6b.toml +0 -44
examples/sft/configs/crafter_lora_qwen0p6b.toml +0 -45
examples/sft/evaluate.py +0 -117
examples/sft/export_dataset.py +0 -117
examples/sft/generate_traces.py +0 -162
examples/swe/__init__.py +0 -12
examples/swe/task_app/README.md +0 -105
examples/swe/task_app/__init__.py +0 -2
examples/swe/task_app/grpo_swe_mini.py +0 -571
examples/swe/task_app/grpo_swe_mini_task_app.py +0 -136
examples/swe/task_app/hosted/README.md +0 -173
examples/swe/task_app/hosted/__init__.py +0 -5
examples/swe/task_app/hosted/branching.py +0 -143
examples/swe/task_app/hosted/environment_routes.py +0 -1289
examples/swe/task_app/hosted/envs/__init__.py +0 -1
examples/swe/task_app/hosted/envs/crafter/__init__.py +0 -6
examples/swe/task_app/hosted/envs/crafter/app.py +0 -1
examples/swe/task_app/hosted/envs/crafter/environment.py +0 -522
examples/swe/task_app/hosted/envs/crafter/policy.py +0 -478
examples/swe/task_app/hosted/envs/crafter/react_agent.py +0 -108
examples/swe/task_app/hosted/envs/crafter/shared.py +0 -305
examples/swe/task_app/hosted/envs/crafter/tools.py +0 -47
examples/swe/task_app/hosted/envs/mini_swe/__init__.py +0 -8
examples/swe/task_app/hosted/envs/mini_swe/environment.py +0 -1164
examples/swe/task_app/hosted/envs/mini_swe/policy.py +0 -355
examples/swe/task_app/hosted/envs/mini_swe/shared.py +0 -83
examples/swe/task_app/hosted/envs/mini_swe/tools.py +0 -96
examples/swe/task_app/hosted/hosted_app.py +0 -204
examples/swe/task_app/hosted/inference/__init__.py +0 -5
examples/swe/task_app/hosted/inference/openai_client.py +0 -618
examples/swe/task_app/hosted/main.py +0 -100
examples/swe/task_app/hosted/policy_routes.py +0 -1079
examples/swe/task_app/hosted/registry.py +0 -195
examples/swe/task_app/hosted/rollout.py +0 -1869
examples/swe/task_app/hosted/storage/__init__.py +0 -5
examples/swe/task_app/hosted/storage/volume.py +0 -211
examples/swe/task_app/hosted/test_agents.py +0 -161
examples/swe/task_app/hosted/test_service.py +0 -137
examples/swe/task_app/hosted/utils.py +0 -62
examples/vlm/README.md +0 -68
examples/vlm/configs/crafter_vlm_gpt4o.toml +0 -44
examples/vlm/crafter_image_only_agent.py +0 -207
examples/vlm/crafter_openai_vlm_agent.py +0 -277
examples/vlm/filter_image_rows.py +0 -63
examples/vlm/run_crafter_vlm_benchmark.py +0 -316
examples/warming_up_to_rl/analyze_trace_db.py +0 -422
examples/warming_up_to_rl/configs/crafter_fft.toml +0 -48
examples/warming_up_to_rl/configs/crafter_fft_4b.toml +0 -54
examples/warming_up_to_rl/configs/eval_fft_qwen4b.toml +0 -20
examples/warming_up_to_rl/configs/eval_groq_qwen32b.toml +0 -13
examples/warming_up_to_rl/configs/eval_modal_qwen4b.toml +0 -23
examples/warming_up_to_rl/configs/rl_from_base_qwen4b.toml +0 -83
examples/warming_up_to_rl/configs/rl_from_ft.toml +0 -56
examples/warming_up_to_rl/export_trace_sft.py +0 -723
examples/warming_up_to_rl/groq_test.py +0 -95
examples/warming_up_to_rl/manage_secrets.py +0 -131
examples/warming_up_to_rl/readme.md +0 -179
examples/warming_up_to_rl/run_eval.py +0 -510
examples/warming_up_to_rl/run_fft_and_save.py +0 -380
examples/warming_up_to_rl/run_local_rollout.py +0 -237
examples/warming_up_to_rl/run_local_rollout_modal.py +0 -246
examples/warming_up_to_rl/run_local_rollout_parallel.py +0 -403
examples/warming_up_to_rl/run_local_rollout_traced.py +0 -475
examples/warming_up_to_rl/run_rl_and_save.py +0 -124
examples/warming_up_to_rl/run_rollout_remote.py +0 -154
examples/warming_up_to_rl/task_app/README.md +0 -42
examples/warming_up_to_rl/task_app/grpo_crafter.py +0 -700
examples/warming_up_to_rl/task_app/grpo_crafter_task_app.py +0 -146
examples/warming_up_to_rl/task_app/synth_envs_hosted/README.md +0 -173
examples/warming_up_to_rl/task_app/synth_envs_hosted/__init__.py +0 -5
examples/warming_up_to_rl/task_app/synth_envs_hosted/branching.py +0 -143
examples/warming_up_to_rl/task_app/synth_envs_hosted/environment_routes.py +0 -1226
examples/warming_up_to_rl/task_app/synth_envs_hosted/envs/__init__.py +0 -1
examples/warming_up_to_rl/task_app/synth_envs_hosted/envs/crafter/__init__.py +0 -6
examples/warming_up_to_rl/task_app/synth_envs_hosted/envs/crafter/app.py +0 -1
examples/warming_up_to_rl/task_app/synth_envs_hosted/envs/crafter/environment.py +0 -522
examples/warming_up_to_rl/task_app/synth_envs_hosted/envs/crafter/policy.py +0 -478
examples/warming_up_to_rl/task_app/synth_envs_hosted/envs/crafter/react_agent.py +0 -108
examples/warming_up_to_rl/task_app/synth_envs_hosted/envs/crafter/shared.py +0 -305
examples/warming_up_to_rl/task_app/synth_envs_hosted/envs/crafter/tools.py +0 -47
examples/warming_up_to_rl/task_app/synth_envs_hosted/hosted_app.py +0 -204
examples/warming_up_to_rl/task_app/synth_envs_hosted/inference/__init__.py +0 -5
examples/warming_up_to_rl/task_app/synth_envs_hosted/inference/openai_client.py +0 -618
examples/warming_up_to_rl/task_app/synth_envs_hosted/main.py +0 -100
examples/warming_up_to_rl/task_app/synth_envs_hosted/policy_routes.py +0 -1083
examples/warming_up_to_rl/task_app/synth_envs_hosted/registry.py +0 -195
examples/warming_up_to_rl/task_app/synth_envs_hosted/rollout.py +0 -1869
examples/warming_up_to_rl/task_app/synth_envs_hosted/storage/__init__.py +0 -5
examples/warming_up_to_rl/task_app/synth_envs_hosted/storage/volume.py +0 -211
examples/warming_up_to_rl/task_app/synth_envs_hosted/test_agents.py +0 -161
examples/warming_up_to_rl/task_app/synth_envs_hosted/test_service.py +0 -137
examples/warming_up_to_rl/task_app/synth_envs_hosted/utils.py +0 -62
synth/__init__.py +0 -14
synth_ai/api/models/supported.py +0 -376
synth_ai/api/train/__init__.py +0 -5
synth_ai/api/train/builders.py +0 -296
synth_ai/api/train/cli.py +0 -606
synth_ai/api/train/config_finder.py +0 -228
synth_ai/api/train/env_resolver.py +0 -347
synth_ai/api/train/pollers.py +0 -75
synth_ai/api/train/supported_algos.py +0 -139
synth_ai/api/train/task_app.py +0 -195
synth_ai/api/train/utils.py +0 -217
synth_ai/cli/_modal_wrapper.py +0 -28
synth_ai/cli/_typer_patch.py +0 -49
synth_ai/cli/balance.py +0 -203
synth_ai/cli/calc.py +0 -69
synth_ai/cli/demo.py +0 -159
synth_ai/cli/legacy_root_backup.py +0 -470
synth_ai/cli/man.py +0 -106
synth_ai/cli/recent.py +0 -127
synth_ai/cli/rl_demo.py +0 -274
synth_ai/cli/status.py +0 -133
synth_ai/cli/task_apps.py +0 -2782
synth_ai/cli/traces.py +0 -163
synth_ai/cli/watch.py +0 -505
synth_ai/config/base_url.py +0 -107
synth_ai/core/experiment.py +0 -13
synth_ai/core/system.py +0 -15
synth_ai/demo_registry.py +0 -295
synth_ai/demos/core/__init__.py +0 -1
synth_ai/demos/core/cli.py +0 -1756
synth_ai/demos/demo_task_apps/core.py +0 -440
synth_ai/demos/demo_task_apps/crafter/grpo_crafter_task_app.py +0 -172
synth_ai/demos/demo_task_apps/math/deploy_task_app.sh +0 -22
synth_ai/demos/demo_task_apps/math/modal_task_app.py +0 -739
synth_ai/demos/demo_task_apps/math/task_app_entry.py +0 -37
synth_ai/environments/__init__.py +0 -31
synth_ai/environments/environment/__init__.py +0 -1
synth_ai/environments/environment/artifacts/__init__.py +0 -1
synth_ai/environments/environment/artifacts/base.py +0 -52
synth_ai/environments/environment/core.py +0 -67
synth_ai/environments/environment/db/__init__.py +0 -1
synth_ai/environments/environment/db/sqlite.py +0 -45
synth_ai/environments/environment/registry.py +0 -233
synth_ai/environments/environment/resources/sqlite.py +0 -45
synth_ai/environments/environment/results.py +0 -1
synth_ai/environments/environment/rewards/__init__.py +0 -1
synth_ai/environments/environment/rewards/core.py +0 -29
synth_ai/environments/environment/shared_engine.py +0 -26
synth_ai/environments/environment/tools/__init__.py +0 -200
synth_ai/environments/examples/__init__.py +0 -1
synth_ai/environments/examples/bandit/__init__.py +0 -33
synth_ai/environments/examples/bandit/engine.py +0 -302
synth_ai/environments/examples/bandit/environment.py +0 -194
synth_ai/environments/examples/bandit/taskset.py +0 -200
synth_ai/environments/examples/crafter_classic/__init__.py +0 -8
synth_ai/environments/examples/crafter_classic/agent_demos/analyze_semantic_words_markdown.py +0 -250
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_comprehensive_evaluation.py +0 -59
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_evaluation_browser.py +0 -152
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_evaluation_config.toml +0 -24
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_evaluation_framework.py +0 -1194
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_modal_ft/crafter_synth_config.toml +0 -56
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_modal_ft/filter_config_modal.toml +0 -32
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_modal_ft/kick_off_ft_modal.py +0 -384
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_modal_ft/old/analyze_action_results.py +0 -53
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_modal_ft/old/analyze_agent_actions.py +0 -178
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_modal_ft/old/analyze_latest_run.py +0 -222
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_modal_ft/old/analyze_lm_traces.py +0 -183
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_modal_ft/old/analyze_no_rewards.py +0 -210
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_modal_ft/old/analyze_trace_issue.py +0 -206
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_modal_ft/old/check_db_schema.py +0 -49
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_modal_ft/old/check_latest_results.py +0 -64
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_modal_ft/old/debug_agent_responses.py +0 -88
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_modal_ft/old/quick_trace_check.py +0 -77
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_openai_ft/compare_experiments.py +0 -324
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_openai_ft/kick_off_ft_oai.py +0 -362
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_openai_ft/multi_model_config.toml +0 -49
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_openai_ft/old/analyze_enhanced_hooks.py +0 -332
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_openai_ft/old/analyze_hook_events.py +0 -97
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_openai_ft/old/analyze_hook_results.py +0 -217
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_openai_ft/old/check_hook_storage.py +0 -87
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_openai_ft/old/check_seeds.py +0 -88
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_openai_ft/old/compare_seed_performance.py +0 -195
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_openai_ft/old/custom_eval_pipelines.py +0 -400
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_openai_ft/old/plot_hook_frequency.py +0 -195
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_openai_ft/old/seed_analysis_summary.py +0 -56
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_openai_ft/run_rollouts_for_models_and_compare_v3.py +0 -858
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_quick_evaluation.py +0 -52
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_react_agent.py +0 -874
synth_ai/environments/examples/crafter_classic/agent_demos/crafter_trace_evaluation.py +0 -1412
synth_ai/environments/examples/crafter_classic/agent_demos/example_v3_usage.py +0 -216
synth_ai/environments/examples/crafter_classic/agent_demos/old/compare_traces.py +0 -296
synth_ai/environments/examples/crafter_classic/agent_demos/old/crafter_comprehensive_evaluation.py +0 -58
synth_ai/environments/examples/crafter_classic/agent_demos/old/crafter_env_serialization.py +0 -464
synth_ai/environments/examples/crafter_classic/agent_demos/old/crafter_evaluation_browser.py +0 -152
synth_ai/environments/examples/crafter_classic/agent_demos/old/crafter_quick_evaluation.py +0 -51
synth_ai/environments/examples/crafter_classic/agent_demos/old/crafter_trace_evaluation.py +0 -1412
synth_ai/environments/examples/crafter_classic/agent_demos/old/debug_player_loss.py +0 -112
synth_ai/environments/examples/crafter_classic/agent_demos/old/diagnose_service.py +0 -203
synth_ai/environments/examples/crafter_classic/agent_demos/old/diagnose_slowness.py +0 -305
synth_ai/environments/examples/crafter_classic/agent_demos/old/eval_by_difficulty.py +0 -126
synth_ai/environments/examples/crafter_classic/agent_demos/old/eval_example.py +0 -94
synth_ai/environments/examples/crafter_classic/agent_demos/old/explore_saved_states.py +0 -142
synth_ai/environments/examples/crafter_classic/agent_demos/old/filter_traces_sft.py +0 -26
synth_ai/environments/examples/crafter_classic/agent_demos/old/filter_traces_sft_OLD.py +0 -984
synth_ai/environments/examples/crafter_classic/agent_demos/old/generate_ft_data_gemini.py +0 -724
synth_ai/environments/examples/crafter_classic/agent_demos/old/generate_ft_data_modal.py +0 -386
synth_ai/environments/examples/crafter_classic/agent_demos/old/generate_ft_metadata.py +0 -205
synth_ai/environments/examples/crafter_classic/agent_demos/old/kick_off_ft_gemini.py +0 -150
synth_ai/environments/examples/crafter_classic/agent_demos/old/kick_off_ft_modal.py +0 -283
synth_ai/environments/examples/crafter_classic/agent_demos/old/prepare_vertex_ft.py +0 -280
synth_ai/environments/examples/crafter_classic/agent_demos/old/profile_env_slowness.py +0 -456
synth_ai/environments/examples/crafter_classic/agent_demos/old/replicate_issue.py +0 -166
synth_ai/environments/examples/crafter_classic/agent_demos/old/run_and_eval.py +0 -102
synth_ai/environments/examples/crafter_classic/agent_demos/old/run_comparison.py +0 -128
synth_ai/environments/examples/crafter_classic/agent_demos/old/run_qwen_rollouts.py +0 -655
synth_ai/environments/examples/crafter_classic/agent_demos/old/trace_eval_OLD.py +0 -202
synth_ai/environments/examples/crafter_classic/agent_demos/old/validate_openai_format.py +0 -166
synth_ai/environments/examples/crafter_classic/config_logging.py +0 -111
synth_ai/environments/examples/crafter_classic/debug_translation.py +0 -0
synth_ai/environments/examples/crafter_classic/engine.py +0 -579
synth_ai/environments/examples/crafter_classic/engine_deterministic_patch.py +0 -64
synth_ai/environments/examples/crafter_classic/engine_helpers/action_map.py +0 -6
synth_ai/environments/examples/crafter_classic/engine_helpers/serialization.py +0 -75
synth_ai/environments/examples/crafter_classic/engine_serialization_patch_v3.py +0 -267
synth_ai/environments/examples/crafter_classic/environment.py +0 -479
synth_ai/environments/examples/crafter_classic/taskset.py +0 -233
synth_ai/environments/examples/crafter_classic/trace_hooks_v3.py +0 -228
synth_ai/environments/examples/crafter_classic/world_config_patch_simple.py +0 -299
synth_ai/environments/examples/crafter_custom/__init__.py +0 -4
synth_ai/environments/examples/crafter_custom/agent_demos/__init__.py +0 -1
synth_ai/environments/examples/crafter_custom/agent_demos/trace_eval.py +0 -202
synth_ai/environments/examples/crafter_custom/crafter/__init__.py +0 -7
synth_ai/environments/examples/crafter_custom/crafter/config.py +0 -182
synth_ai/environments/examples/crafter_custom/crafter/constants.py +0 -8
synth_ai/environments/examples/crafter_custom/crafter/engine.py +0 -269
synth_ai/environments/examples/crafter_custom/crafter/env.py +0 -262
synth_ai/environments/examples/crafter_custom/crafter/objects.py +0 -417
synth_ai/environments/examples/crafter_custom/crafter/recorder.py +0 -187
synth_ai/environments/examples/crafter_custom/crafter/worldgen.py +0 -118
synth_ai/environments/examples/crafter_custom/dataset_builder.py +0 -373
synth_ai/environments/examples/crafter_custom/environment.py +0 -312
synth_ai/environments/examples/crafter_custom/old/analyze_diamond_issue.py +0 -159
synth_ai/environments/examples/crafter_custom/old/analyze_diamond_spawning.py +0 -158
synth_ai/environments/examples/crafter_custom/old/compare_worlds.py +0 -71
synth_ai/environments/examples/crafter_custom/old/dataset_stats.py +0 -105
synth_ai/environments/examples/crafter_custom/old/diamond_spawning_summary.py +0 -119
synth_ai/environments/examples/crafter_custom/old/example_dataset_usage.py +0 -52
synth_ai/environments/examples/crafter_custom/run_dataset.py +0 -305
synth_ai/environments/examples/enron/art_helpers/email_search_tools.py +0 -156
synth_ai/environments/examples/enron/art_helpers/local_email_db.py +0 -281
synth_ai/environments/examples/enron/art_helpers/types_enron.py +0 -25
synth_ai/environments/examples/enron/engine.py +0 -295
synth_ai/environments/examples/enron/environment.py +0 -166
synth_ai/environments/examples/enron/taskset.py +0 -112
synth_ai/environments/examples/enron/units/keyword_stats.py +0 -112
synth_ai/environments/examples/minigrid/__init__.py +0 -48
synth_ai/environments/examples/minigrid/agent_demos/minigrid_evaluation_framework.py +0 -1188
synth_ai/environments/examples/minigrid/agent_demos/minigrid_quick_evaluation.py +0 -48
synth_ai/environments/examples/minigrid/agent_demos/minigrid_react_agent.py +0 -562
synth_ai/environments/examples/minigrid/agent_demos/minigrid_trace_evaluation.py +0 -221
synth_ai/environments/examples/minigrid/engine.py +0 -589
synth_ai/environments/examples/minigrid/environment.py +0 -274
synth_ai/environments/examples/minigrid/environment_mapping.py +0 -242
synth_ai/environments/examples/minigrid/puzzle_loader.py +0 -417
synth_ai/environments/examples/minigrid/taskset.py +0 -583
synth_ai/environments/examples/nethack/__init__.py +0 -7
synth_ai/environments/examples/nethack/achievements.py +0 -337
synth_ai/environments/examples/nethack/agent_demos/nethack_evaluation_framework.py +0 -981
synth_ai/environments/examples/nethack/agent_demos/nethack_quick_evaluation.py +0 -74
synth_ai/environments/examples/nethack/agent_demos/nethack_react_agent.py +0 -831
synth_ai/environments/examples/nethack/engine.py +0 -739
synth_ai/environments/examples/nethack/environment.py +0 -256
synth_ai/environments/examples/nethack/helpers/__init__.py +0 -41
synth_ai/environments/examples/nethack/helpers/action_mapping.py +0 -301
synth_ai/environments/examples/nethack/helpers/nle_wrapper.py +0 -402
synth_ai/environments/examples/nethack/helpers/observation_utils.py +0 -433
synth_ai/environments/examples/nethack/helpers/recording_wrapper.py +0 -200
synth_ai/environments/examples/nethack/helpers/trajectory_recorder.py +0 -269
synth_ai/environments/examples/nethack/helpers/visualization/replay_viewer.py +0 -308
synth_ai/environments/examples/nethack/helpers/visualization/visualizer.py +0 -431
synth_ai/environments/examples/nethack/taskset.py +0 -323
synth_ai/environments/examples/red/__init__.py +0 -7
synth_ai/environments/examples/red/agent_demos/__init__.py +0 -1
synth_ai/environments/examples/red/config_logging.py +0 -110
synth_ai/environments/examples/red/engine.py +0 -694
synth_ai/environments/examples/red/engine_helpers/__init__.py +0 -1
synth_ai/environments/examples/red/engine_helpers/memory_map.py +0 -28
synth_ai/environments/examples/red/engine_helpers/reward_components.py +0 -276
synth_ai/environments/examples/red/engine_helpers/reward_library/__init__.py +0 -142
synth_ai/environments/examples/red/engine_helpers/reward_library/adaptive_rewards.py +0 -57
synth_ai/environments/examples/red/engine_helpers/reward_library/battle_rewards.py +0 -284
synth_ai/environments/examples/red/engine_helpers/reward_library/composite_rewards.py +0 -150
synth_ai/environments/examples/red/engine_helpers/reward_library/economy_rewards.py +0 -138
synth_ai/environments/examples/red/engine_helpers/reward_library/efficiency_rewards.py +0 -57
synth_ai/environments/examples/red/engine_helpers/reward_library/exploration_rewards.py +0 -331
synth_ai/environments/examples/red/engine_helpers/reward_library/novelty_rewards.py +0 -121
synth_ai/environments/examples/red/engine_helpers/reward_library/pallet_town_rewards.py +0 -559
synth_ai/environments/examples/red/engine_helpers/reward_library/pokemon_rewards.py +0 -313
synth_ai/environments/examples/red/engine_helpers/reward_library/social_rewards.py +0 -148
synth_ai/environments/examples/red/engine_helpers/reward_library/story_rewards.py +0 -247
synth_ai/environments/examples/red/engine_helpers/screen_analysis.py +0 -368
synth_ai/environments/examples/red/engine_helpers/state_extraction.py +0 -140
synth_ai/environments/examples/red/environment.py +0 -238
synth_ai/environments/examples/red/taskset.py +0 -79
synth_ai/environments/examples/red/units/__init__.py +0 -1
synth_ai/environments/examples/sokoban/__init__.py +0 -1
synth_ai/environments/examples/sokoban/agent_demos/sokoban_full_eval.py +0 -899
synth_ai/environments/examples/sokoban/engine.py +0 -678
synth_ai/environments/examples/sokoban/engine_helpers/__init__.py +0 -1
synth_ai/environments/examples/sokoban/engine_helpers/room_utils.py +0 -657
synth_ai/environments/examples/sokoban/engine_helpers/vendored/__init__.py +0 -18
synth_ai/environments/examples/sokoban/engine_helpers/vendored/envs/__init__.py +0 -3
synth_ai/environments/examples/sokoban/engine_helpers/vendored/envs/boxoban_env.py +0 -131
synth_ai/environments/examples/sokoban/engine_helpers/vendored/envs/render_utils.py +0 -370
synth_ai/environments/examples/sokoban/engine_helpers/vendored/envs/room_utils.py +0 -332
synth_ai/environments/examples/sokoban/engine_helpers/vendored/envs/sokoban_env.py +0 -306
synth_ai/environments/examples/sokoban/engine_helpers/vendored/envs/sokoban_env_fixed_targets.py +0 -67
synth_ai/environments/examples/sokoban/engine_helpers/vendored/envs/sokoban_env_pull.py +0 -115
synth_ai/environments/examples/sokoban/engine_helpers/vendored/envs/sokoban_env_two_player.py +0 -123
synth_ai/environments/examples/sokoban/engine_helpers/vendored/envs/sokoban_env_variations.py +0 -394
synth_ai/environments/examples/sokoban/environment.py +0 -229
synth_ai/environments/examples/sokoban/generate_verified_puzzles.py +0 -440
synth_ai/environments/examples/sokoban/puzzle_loader.py +0 -312
synth_ai/environments/examples/sokoban/taskset.py +0 -428
synth_ai/environments/examples/tictactoe/__init__.py +0 -1
synth_ai/environments/examples/tictactoe/engine.py +0 -368
synth_ai/environments/examples/tictactoe/environment.py +0 -240
synth_ai/environments/examples/tictactoe/taskset.py +0 -215
synth_ai/environments/examples/verilog/__init__.py +0 -10
synth_ai/environments/examples/verilog/engine.py +0 -329
synth_ai/environments/examples/verilog/environment.py +0 -350
synth_ai/environments/examples/verilog/taskset.py +0 -420
synth_ai/environments/examples/wordle/__init__.py +0 -29
synth_ai/environments/examples/wordle/engine.py +0 -398
synth_ai/environments/examples/wordle/environment.py +0 -159
synth_ai/environments/examples/wordle/helpers/generate_instances_wordfreq.py +0 -75
synth_ai/environments/examples/wordle/taskset.py +0 -230
synth_ai/environments/reproducibility/core.py +0 -42
synth_ai/environments/reproducibility/helpers.py +0 -0
synth_ai/environments/reproducibility/tree.py +0 -363
synth_ai/environments/service/app.py +0 -97
synth_ai/environments/service/core_routes.py +0 -1021
synth_ai/environments/service/external_registry.py +0 -56
synth_ai/environments/service/registry.py +0 -9
synth_ai/environments/stateful/__init__.py +0 -1
synth_ai/environments/stateful/core.py +0 -163
synth_ai/environments/stateful/engine.py +0 -21
synth_ai/environments/stateful/state.py +0 -7
synth_ai/environments/tasks/api.py +0 -19
synth_ai/environments/tasks/core.py +0 -81
synth_ai/environments/tasks/filters.py +0 -40
synth_ai/environments/tasks/utils.py +0 -90
synth_ai/environments/v0_observability/history.py +0 -3
synth_ai/environments/v0_observability/log.py +0 -2
synth_ai/evals/base.py +0 -13
synth_ai/handshake.py +0 -109
synth_ai/http.py +0 -26
synth_ai/http_client.py +0 -136
synth_ai/inference/__init__.py +0 -5
synth_ai/inference/client.py +0 -34
synth_ai/jobs/client.py +0 -271
synth_ai/learning/__init__.py +0 -59
synth_ai/learning/client.py +0 -241
synth_ai/learning/ft_client.py +0 -7
synth_ai/learning/health.py +0 -49
synth_ai/learning/jobs.py +0 -201
synth_ai/learning/rl/client.py +0 -267
synth_ai/learning/rl/contracts.py +0 -27
synth_ai/learning/rl/env_keys.py +0 -166
synth_ai/learning/rl/secrets.py +0 -13
synth_ai/learning/sft/client.py +0 -68
synth_ai/learning/sft/config.py +0 -270
synth_ai/learning/sft/data.py +0 -295
synth_ai/learning/validators.py +0 -49
synth_ai/lm/__init__.py +0 -25
synth_ai/main.py +0 -6
synth_ai/task/__init__.py +0 -102
synth_ai/task/apps/__init__.py +0 -128
synth_ai/task/contracts.py +0 -137
synth_ai/task/datasets.py +0 -108
synth_ai/task/proxy.py +0 -259
synth_ai/task/server.py +0 -424
synth_ai/task/tracing_utils.py +0 -84
synth_ai/task/validators.py +0 -11
synth_ai/tracing_v3/__init__.py +0 -97
synth_ai/tracing_v3/config.py +0 -84
synth_ai/tracing_v3/db_config.py +0 -194
synth_ai/tracing_v3/decorators.py +0 -369
synth_ai/tracing_v3/examples/basic_usage.py +0 -189
synth_ai/tracing_v3/llm_call_record_helpers.py +0 -337
synth_ai/tracing_v3/migration_helper.py +0 -120
synth_ai/tracing_v3/replica_sync.py +0 -258
synth_ai/tracing_v3/session_tracer.py +0 -530
synth_ai/tracing_v3/storage/base.py +0 -210
synth_ai/tracing_v3/storage/config.py +0 -75
synth_ai/tracing_v3/storage/factory.py +0 -39
synth_ai/tracing_v3/storage/utils.py +0 -204
synth_ai/tracing_v3/turso/daemon.py +0 -149
synth_ai/tracing_v3/turso/models.py +0 -469
synth_ai/tracing_v3/turso/native_manager.py +0 -1173
synth_ai/tracing_v3/utils.py +0 -108
synth_ai/v0/api/__init__.py +0 -8
synth_ai/v0/api/models/__init__.py +0 -8
synth_ai/v0/api/models/supported.py +0 -8
synth_ai/v0/config/__init__.py +0 -15
synth_ai/v0/config/base_url.py +0 -12
synth_ai/v0/lm/__init__.py +0 -51
synth_ai/v0/lm/caching/constants.py +0 -6
synth_ai/v0/lm/caching/dbs.py +0 -0
synth_ai/v0/lm/caching/ephemeral.py +0 -100
synth_ai/v0/lm/caching/handler.py +0 -137
synth_ai/v0/lm/caching/initialize.py +0 -11
synth_ai/v0/lm/caching/persistent.py +0 -114
synth_ai/v0/lm/config.py +0 -115
synth_ai/v0/lm/constants.py +0 -32
synth_ai/v0/lm/core/__init__.py +0 -8
synth_ai/v0/lm/core/all.py +0 -73
synth_ai/v0/lm/core/exceptions.py +0 -5
synth_ai/v0/lm/core/main.py +0 -331
synth_ai/v0/lm/core/main_v3.py +0 -594
synth_ai/v0/lm/core/synth_models.py +0 -35
synth_ai/v0/lm/core/vendor_clients.py +0 -190
synth_ai/v0/lm/cost/__init__.py +0 -0
synth_ai/v0/lm/cost/monitor.py +0 -1
synth_ai/v0/lm/cost/statefulness.py +0 -1
synth_ai/v0/lm/injection.py +0 -80
synth_ai/v0/lm/overrides.py +0 -206
synth_ai/v0/lm/provider_support/__init__.py +0 -8
synth_ai/v0/lm/provider_support/anthropic.py +0 -972
synth_ai/v0/lm/provider_support/openai.py +0 -1139
synth_ai/v0/lm/provider_support/suppress_logging.py +0 -31
synth_ai/v0/lm/structured_outputs/__init__.py +0 -0
synth_ai/v0/lm/structured_outputs/handler.py +0 -440
synth_ai/v0/lm/structured_outputs/inject.py +0 -297
synth_ai/v0/lm/structured_outputs/rehabilitate.py +0 -185
synth_ai/v0/lm/tools/__init__.py +0 -3
synth_ai/v0/lm/tools/base.py +0 -172
synth_ai/v0/lm/unified_interface.py +0 -202
synth_ai/v0/lm/vendors/__init__.py +0 -0
synth_ai/v0/lm/vendors/base.py +0 -81
synth_ai/v0/lm/vendors/core/__init__.py +0 -0
synth_ai/v0/lm/vendors/core/anthropic_api.py +0 -387
synth_ai/v0/lm/vendors/core/gemini_api.py +0 -292
synth_ai/v0/lm/vendors/core/mistral_api.py +0 -322
synth_ai/v0/lm/vendors/core/openai_api.py +0 -227
synth_ai/v0/lm/vendors/core/synth_dev_api.py +0 -0
synth_ai/v0/lm/vendors/local/__init__.py +0 -0
synth_ai/v0/lm/vendors/local/ollama.py +0 -0
synth_ai/v0/lm/vendors/openai_standard.py +0 -782
synth_ai/v0/lm/vendors/openai_standard_responses.py +0 -259
synth_ai/v0/lm/vendors/retries.py +0 -22
synth_ai/v0/lm/vendors/supported/__init__.py +0 -0
synth_ai/v0/lm/vendors/supported/custom_endpoint.py +0 -415
synth_ai/v0/lm/vendors/supported/deepseek.py +0 -69
synth_ai/v0/lm/vendors/supported/grok.py +0 -75
synth_ai/v0/lm/vendors/supported/groq.py +0 -16
synth_ai/v0/lm/vendors/supported/ollama.py +0 -15
synth_ai/v0/lm/vendors/supported/openrouter.py +0 -74
synth_ai/v0/lm/vendors/supported/together.py +0 -11
synth_ai/v0/lm/vendors/synth_client.py +0 -835
synth_ai/v0/lm/warmup.py +0 -186
synth_ai/v0/tracing/__init__.py +0 -0
synth_ai/v0/tracing/abstractions.py +0 -224
synth_ai/v0/tracing/base_client.py +0 -91
synth_ai/v0/tracing/client_manager.py +0 -131
synth_ai/v0/tracing/config.py +0 -142
synth_ai/v0/tracing/context.py +0 -146
synth_ai/v0/tracing/decorators.py +0 -682
synth_ai/v0/tracing/events/__init__.py +0 -0
synth_ai/v0/tracing/events/manage.py +0 -147
synth_ai/v0/tracing/events/scope.py +0 -86
synth_ai/v0/tracing/events/store.py +0 -228
synth_ai/v0/tracing/immediate_client.py +0 -151
synth_ai/v0/tracing/local.py +0 -18
synth_ai/v0/tracing/log_client_base.py +0 -73
synth_ai/v0/tracing/retry_queue.py +0 -186
synth_ai/v0/tracing/trackers.py +0 -515
synth_ai/v0/tracing/upload.py +0 -409
synth_ai/v0/tracing/utils.py +0 -9
synth_ai/v0/tracing_v1/__init__.py +0 -16
synth_ai/v0/tracing_v1/abstractions.py +0 -224
synth_ai/v0/tracing_v1/base_client.py +0 -91
synth_ai/v0/tracing_v1/client_manager.py +0 -131
synth_ai/v0/tracing_v1/config.py +0 -142
synth_ai/v0/tracing_v1/context.py +0 -146
synth_ai/v0/tracing_v1/decorators.py +0 -703
synth_ai/v0/tracing_v1/events/__init__.py +0 -0
synth_ai/v0/tracing_v1/events/manage.py +0 -147
synth_ai/v0/tracing_v1/events/scope.py +0 -86
synth_ai/v0/tracing_v1/events/store.py +0 -228
synth_ai/v0/tracing_v1/immediate_client.py +0 -151
synth_ai/v0/tracing_v1/local.py +0 -18
synth_ai/v0/tracing_v1/log_client_base.py +0 -73
synth_ai/v0/tracing_v1/retry_queue.py +0 -186
synth_ai/v0/tracing_v1/trackers.py +0 -515
synth_ai/v0/tracing_v1/upload.py +0 -527
synth_ai/v0/tracing_v1/utils.py +0 -9
synth_ai/v0/tracing_v3/__init__.py +0 -10
synth_ai/v0/tracing_v3/abstractions.py +0 -3
synth_ai/v0/tracing_v3/decorators.py +0 -3
synth_ai/v0/tracing_v3/llm_call_record_helpers.py +0 -3
synth_ai/v0/tracing_v3/session_tracer.py +0 -3
synth_ai-0.2.9.dev11.dist-info/METADATA +0 -191
synth_ai-0.2.9.dev11.dist-info/RECORD +0 -571
synth_ai-0.2.9.dev11.dist-info/entry_points.txt +0 -3
synth_ai-0.2.9.dev11.dist-info/top_level.txt +0 -3
/synth_ai/{demos/demo_task_apps → cli/demo_apps}/crafter/__init__.py +0 -0
/synth_ai/{demos → cli/demo_apps}/demo_task_apps/__init__.py +0 -0
/synth_ai/{demos → cli/demo_apps}/demo_task_apps/crafter/configs/crafter_fft_4b.toml +0 -0
/synth_ai/{demos → cli/demo_apps}/demo_task_apps/crafter/configs/rl_from_base_qwen4b.toml +0 -0
/synth_ai/{demos → cli/demo_apps}/demo_task_apps/math/__init__.py +0 -0
/synth_ai/{demos → cli/demo_apps}/demo_task_apps/math/_common.py +0 -0
/synth_ai/{demos → cli/demo_apps}/demo_task_apps/math/app.py +0 -0
/synth_ai/{demos → cli/demo_apps}/demo_task_apps/math/config.toml +0 -0
/synth_ai/{demos → cli/demo_apps}/demo_task_apps/math/deploy_modal.py +0 -0
/synth_ai/{v0/lm/caching → core/apps}/__init__.py +0 -0
/synth_ai/{tracing_v3 → core/tracing_v3}/abstractions.py +0 -0
/synth_ai/{tracing_v3 → core/tracing_v3}/hooks.py +0 -0
/synth_ai/{tracing_v3 → core/tracing_v3}/lm_call_record_abstractions.py +0 -0
/synth_ai/{tracing_v3 → core/tracing_v3}/storage/__init__.py +0 -0
/synth_ai/{tracing_v3 → core/tracing_v3}/storage/exceptions.py +0 -0
/synth_ai/{tracing_v3 → core/tracing_v3}/storage/types.py +0 -0
/synth_ai/{compound/cais.py → py.typed} +0 -0
/synth_ai/{learning → sdk/learning}/algorithms.py +0 -0
/synth_ai/{learning → sdk/learning}/config.py +0 -0
/synth_ai/{learning → sdk/learning}/constants.py +0 -0
/synth_ai/{learning → sdk/learning}/core.py +0 -0
/synth_ai/{learning → sdk/learning}/gateway.py +0 -0
/synth_ai/{learning → sdk/learning}/rl/__init__.py +0 -0
/synth_ai/{learning → sdk/learning}/rl/config.py +0 -0
/synth_ai/{learning → sdk/learning}/rl_client.py +0 -0
/synth_ai/{learning → sdk/learning}/sft/__init__.py +0 -0
/synth_ai/{learning → sdk/learning}/sse.py +0 -0
/synth_ai/{task → sdk/task}/auth.py +0 -0
/synth_ai/{task → sdk/task}/client.py +0 -0
/synth_ai/{task → sdk/task}/errors.py +0 -0
/synth_ai/{task → sdk/task}/health.py +0 -0
/synth_ai/{task → sdk/task}/json.py +0 -0
/synth_ai/{task → sdk/task}/rubrics.py +0 -0
/synth_ai/{task → sdk/task}/vendors.py +0 -0
{synth_ai-0.2.9.dev11.dist-info → synth_ai-0.4.1.dist-info}/WHEEL +0 -0
{synth_ai-0.2.9.dev11.dist-info → synth_ai-0.4.1.dist-info}/licenses/LICENSE +0 -0

examples/rl/task_app/math_single_step.py DELETED Viewed

@@ -1,991 +0,0 @@
-"""Task app configuration for a single-step math reasoning environment."""
-from __future__ import annotations
-import contextlib
-import os
-import random
-import re
-import uuid
-from collections.abc import Iterable, Mapping, MutableMapping, Sequence
-from dataclasses import dataclass
-from pathlib import Path
-from typing import Any, cast
-import httpx
-from datasets import load_dataset
-from fastapi import APIRouter, HTTPException, Request
-from pydantic import BaseModel, Field
-from synth_ai.task.apps import ModalDeploymentConfig, TaskAppEntry, register_task_app
-from synth_ai.task.contracts import (
-    RolloutMetrics,
-    RolloutRequest,
-    RolloutResponse,
-    RolloutStep,
-    RolloutTrajectory,
-    TaskInfo,
-)
-from synth_ai.task.datasets import TaskDatasetRegistry, TaskDatasetSpec
-from synth_ai.task.errors import http_exception
-from synth_ai.task.rubrics import Rubric, load_rubric
-from synth_ai.task.server import ProxyConfig, RubricBundle, TaskAppConfig
-from synth_ai.task.tracing_utils import (
-    build_tracer_factory,
-    resolve_sft_output_dir,
-    resolve_tracing_db_url,
-    tracing_env_enabled,
-)
-from synth_ai.task.vendors import normalize_vendor_keys
-from synth_ai.tracing_v3.session_tracer import SessionTracer
-REPO_ROOT = Path(__file__).resolve().parents[3]
-_modal_volume_candidate = Path(
-    os.getenv("MATH_MODAL_DATASET_DIR", "/modal_volumes/math_dataset")
-).expanduser()
-_modal_volume_root: Path | None = None
-try:
-    _modal_volume_candidate.mkdir(parents=True, exist_ok=True)
-    _modal_volume_root = _modal_volume_candidate
-except Exception:
-    if _modal_volume_candidate.exists():
-        _modal_volume_root = _modal_volume_candidate
-if _modal_volume_root is not None:
-    hf_cache_path = _modal_volume_root / "hf_cache"
-    local_dataset_dir = _modal_volume_root / "jsonl"
-    local_dataset_dir.mkdir(parents=True, exist_ok=True)
-    os.environ.setdefault("MATH_DATASET_LOCAL_DIR", str(local_dataset_dir))
-else:
-    hf_cache_path = Path(
-        os.getenv("MATH_DATASET_CACHE_DIR", str(REPO_ROOT / ".cache" / "hf-datasets"))
-    ).expanduser()
-hf_cache_path.mkdir(parents=True, exist_ok=True)
-os.environ.setdefault("MATH_DATASET_CACHE_DIR", str(hf_cache_path))
-os.environ.setdefault("HF_HOME", str(hf_cache_path))
-os.environ.setdefault("HF_DATASETS_CACHE", str(hf_cache_path))
-os.environ.setdefault("HUGGINGFACE_HUB_CACHE", str(hf_cache_path))
-HF_DATASETS_CACHE = hf_cache_path
-DATASET_NAME = os.getenv("MATH_DATASET_NAME", "nlile/hendrycks-MATH-benchmark")
-DATASET_CONFIG = os.getenv("MATH_DATASET_CONFIG", "")
-DEFAULT_SPLIT = os.getenv("MATH_DATASET_DEFAULT_SPLIT", "train")
-AVAILABLE_SPLITS: tuple[str, ...] = (
-    DEFAULT_SPLIT,
-    os.getenv("MATH_DATASET_VALIDATION_SPLIT", "test"),
-    os.getenv("MATH_DATASET_TEST_SPLIT", "test"),
-)
-TOOL_NAME = "math_submit"
-PROBLEM_KEYS: tuple[str, ...] = ("problem", "question", "prompt", "query")
-SOLUTION_KEYS: tuple[str, ...] = ("solution", "answer", "final_answer", "solution_text")
-REWARD_POSITIVE = float(os.getenv("MATH_REWARD_POSITIVE", "1.0"))
-REWARD_NEGATIVE_NO_TOOL = float(os.getenv("MATH_REWARD_NEGATIVE_NO_TOOL", "-1.0"))
-REWARD_NEGATIVE_NO_ANSWER = float(os.getenv("MATH_REWARD_NEGATIVE_NO_ANSWER", "-0.5"))
-HF_TOKEN_ENV_KEYS: tuple[str, ...] = (
-    "HF_DATASETS_TOKEN",
-    "HUGGINGFACEHUB_API_TOKEN",
-    "HUGGINGFACE_TOKEN",
-)
-## Single-source dataset policy: use a single known-good HF dataset id by default.
-MATH_DATASET_SPEC = TaskDatasetSpec(
-    id="math_single_step",
-    name="MATH Single Step",
-    version="1.0.0",
-    splits=list(dict.fromkeys(split for split in AVAILABLE_SPLITS if split)),
-    default_split=DEFAULT_SPLIT,
-    description="Single-step math reasoning problems sourced from the Hendrycks MATH dataset.",
-)
-_BOXED_MARKERS: tuple[str, ...] = ("\\boxed", "boxed")
-def _extract_boxed(text: str) -> str | None:
-    if not text:
-        return None
-    for marker in _BOXED_MARKERS:
-        start = text.find(marker)
-        if start == -1:
-            continue
-        brace_start = text.find("{", start)
-        if brace_start == -1:
-            continue
-        depth = 1
-        idx = brace_start + 1
-        while idx < len(text) and depth > 0:
-            ch = text[idx]
-            if ch == "{":
-                depth += 1
-            elif ch == "}":
-                depth -= 1
-            idx += 1
-        if depth == 0:
-            return text[brace_start + 1 : idx - 1].strip()
-    return None
-_FRAC_PATTERN = re.compile(r"\\?frac\{([^{}]+)\}\{([^{}]+)\}")
-_SQRT_PATTERN = re.compile(r"\\?sqrt\{([^{}]+)\}")
-def _normalize_final_answer(text: str) -> str:
-    raw = str(text or "").strip()
-    if not raw:
-        return ""
-    boxed = _extract_boxed(raw)
-    if boxed:
-        raw = boxed
-    raw = raw.strip().strip("$")
-    raw = raw.replace("\\left", "").replace("\\right", "")
-    raw = raw.replace("\\!", "").replace("\\,", " ").replace("\\;", " ")
-    raw = raw.replace("left", "").replace("right", "")
-    raw = raw.replace("\\times", "*").replace("\\cdot", "*")
-    raw = raw.replace("\\pi", "pi").replace("\\theta", "theta").replace("\\phi", "phi")
-    raw = raw.replace("\\pm", "+/-").replace("\\mp", "-/+")
-    raw = raw.replace("^{\\circ}", "deg").replace("^\\circ", "deg").replace("\\circ", "deg")
-    def _frac_sub(match: re.Match[str]) -> str:
-        num = match.group(1).strip()
-        den = match.group(2).strip()
-        return f"({num})/({den})"
-    def _sqrt_sub(match: re.Match[str]) -> str:
-        inner = match.group(1).strip()
-        return f"sqrt({inner})"
-    raw = _FRAC_PATTERN.sub(_frac_sub, raw)
-    raw = _SQRT_PATTERN.sub(_sqrt_sub, raw)
-    raw = raw.replace("\\", "")
-    raw = raw.replace("{", "").replace("}", "")
-    raw = raw.replace(" ", "")
-    raw = raw.rstrip(".")
-    return raw
-class MathDataset:
-    """Lazy Hugging Face dataset loader for EleutherAI/math splits."""
-    def __init__(self, *, name: str, config: str, splits: Sequence[str]) -> None:
-        self.name = name
-        self.config = config
-        self.splits = [split for split in splits if split]
-        self._cache: dict[str, Any] = {}
-        self._local_dir = os.getenv("MATH_DATASET_LOCAL_DIR")
-        self._hf_token: str | None = None
-        for key in HF_TOKEN_ENV_KEYS:
-            value = os.getenv(key)
-            if value:
-                trimmed = value.strip()
-                if trimmed:
-                    self._hf_token = trimmed
-                    break
-        # No multi-candidate fallback: enforce explicit dataset id
-    def _local_file_for_split(self, split: str) -> Path | None:
-        specific = os.getenv(f"MATH_DATASET_LOCAL_{split.upper()}_FILE")
-        if specific:
-            path = Path(specific).expanduser()
-            if path.exists():
-                return path
-        if self._local_dir:
-            candidate = Path(self._local_dir).expanduser() / f"{split}.jsonl"
-            if candidate.exists():
-                return candidate
-        return None
-    def _load_split(self, split: str):
-        # Treat 'validation' as an alias for 'test' for datasets without a separate validation split
-        if split not in self.splits and split.lower() == "validation":
-            split = "test"
-        if split not in self.splits:
-            raise ValueError(f"Unknown split '{split}'. Available: {self.splits}")
-        if split not in self._cache:
-            local_file = self._local_file_for_split(split)
-            if local_file is not None:
-                dataset = load_dataset(
-                    "json", data_files=str(local_file), cache_dir=str(HF_DATASETS_CACHE)
-                )
-                self._cache[split] = dataset["train"]
-            else:
-                try:
-                    load_kwargs: dict[str, Any] = {"split": split}
-                    if self.config:
-                        load_kwargs["name"] = self.config
-                    if self._hf_token:
-                        load_kwargs["use_auth_token"] = self._hf_token
-                    ds = load_dataset(self.name, cache_dir=str(HF_DATASETS_CACHE), **load_kwargs)
-                    self._cache[split] = ds
-                    if self._local_dir:
-                        local_dir = Path(self._local_dir).expanduser()
-                        target = local_dir / f"{split}.jsonl"
-                        if not target.exists() and hasattr(ds, "to_json"):
-                            tmp_path = target.with_name(target.name + ".tmp")
-                            try:
-                                local_dir.mkdir(parents=True, exist_ok=True)
-                                ds.to_json(str(tmp_path))
-                                tmp_path.replace(target)
-                            except Exception:
-                                with contextlib.suppress(FileNotFoundError):
-                                    tmp_path.unlink()
-                except Exception as exc:
-                    hints = [
-                        "Failed to download MATH dataset from Hugging Face.",
-                        f"Dataset: {self.name} | Config: {self.config or 'none'} | Split: {split}",
-                        "If this persists, verify MATH_DATASET_NAME/MATH_DATASET_CONFIG or set MATH_DATASET_LOCAL_DIR to pre-downloaded JSONL files.",
-                    ]
-                    raise RuntimeError(" ".join(hints)) from exc
-        return self._cache[split]
-    def sample(self, *, split: str, index: int | None = None) -> dict[str, Any]:
-        dataset = self._load_split(split)
-        if len(dataset) == 0:
-            raise RuntimeError(f"Dataset split '{split}' is empty")
-        if index is None:
-            index = random.randint(0, len(dataset) - 1)
-        idx = int(index) % len(dataset)
-        item = dataset[int(idx)]
-        raw_problem = ""
-        for key in PROBLEM_KEYS:
-            value = item.get(key)
-            if isinstance(value, str) and value.strip():
-                raw_problem = value.strip()
-                break
-        if not raw_problem:
-            raise RuntimeError(f"Sample missing problem field for split '{split}' index {idx}")
-        solution_value: Any = None
-        for key in SOLUTION_KEYS:
-            if key in item:
-                solution_value = item[key]
-                break
-        if solution_value is None:
-            raise RuntimeError(f"Sample missing solution field for split '{split}' index {idx}")
-        # Solutions can contain reasoning and final answer; take final line by convention
-        if isinstance(solution_value, list):
-            solution_text = "\n".join(str(part) for part in solution_value)
-        else:
-            solution_text = str(solution_value)
-        lines = [line.strip() for line in solution_text.strip().splitlines() if line.strip()]
-        final_line = ""
-        for line in reversed(lines):
-            lowered = line.lower()
-            if "boxed" in lowered or "answer" in lowered:
-                final_line = line
-                break
-        if not final_line and lines:
-            final_line = lines[-1]
-        candidate_answer = final_line or solution_text.strip()
-        normalized_answer = _normalize_final_answer(candidate_answer)
-        if not normalized_answer:
-            normalized_answer = _normalize_final_answer(solution_text)
-        return {
-            "index": idx,
-            "split": split,
-            "problem": raw_problem,
-            "answer": normalized_answer,
-            "raw_solution": solution_text,
-        }
-    def size(self, split: str) -> int:
-        dataset = self._load_split(split)
-        return len(dataset)
-    def ensure_ready(self, required_splits: Sequence[str]) -> None:
-        errors: list[str] = []
-        for split in required_splits:
-            if not split:
-                continue
-            try:
-                self._load_split(split)
-            except Exception as exc:
-                errors.append(f"{split}: {exc}")
-        if errors:
-            raise RuntimeError("Dataset preparation failed:\n" + "\n".join(errors))
-@dataclass
-class MathEnvState:
-    env_id: str
-    split: str
-    index: int
-    problem: str
-    answer: str
-    raw_solution: str
-    done: bool = False
-class MathEnvironmentManager:
-    """Stores in-flight environment state keyed by env_id."""
-    def __init__(self, dataset: MathDataset) -> None:
-        self.dataset = dataset
-        self._states: dict[str, MathEnvState] = {}
-    def create(self, *, split: str, index: int | None, seed: int | None) -> MathEnvState:
-        if index is None and seed is not None:
-            index = seed
-        sample = self.dataset.sample(split=split, index=index)
-        env_id = str(uuid.uuid4())
-        state = MathEnvState(
-            env_id=env_id,
-            split=split,
-            index=int(sample["index"]),
-            problem=sample["problem"],
-            answer=sample["answer"],
-            raw_solution=sample["raw_solution"],
-        )
-        self._states[env_id] = state
-        return state
-    def get(self, env_id: str) -> MathEnvState:
-        if env_id not in self._states:
-            raise KeyError(f"Unknown env_id: {env_id}")
-        return self._states[env_id]
-    def terminate(self, env_id: str) -> None:
-        self._states.pop(env_id, None)
-class InitializePayload(BaseModel):
-    seed: int | None = None
-    config: dict[str, Any] = Field(default_factory=dict)
-def _observation_from_state(state: MathEnvState) -> dict[str, Any]:
-    return {
-        "problem": state.problem,
-        "split": state.split,
-        "index": state.index,
-    }
-def _score_submission(
-    state: MathEnvState, tool_calls: Sequence[Mapping[str, Any]]
-) -> tuple[float, str, bool]:
-    if not tool_calls:
-        return REWARD_NEGATIVE_NO_TOOL, "missing_tool_call", False
-    call = tool_calls[0]
-    tool_name = str(call.get("tool") or "").strip()
-    if tool_name != TOOL_NAME:
-        return REWARD_NEGATIVE_NO_TOOL, "wrong_tool", False
-    args = call.get("args") or {}
-    answer = _normalize_final_answer(str(args.get("answer") or ""))
-    if not answer:
-        return REWARD_NEGATIVE_NO_ANSWER, "blank_answer", False
-    is_correct = answer == state.answer
-    return (
-        (REWARD_POSITIVE if is_correct else 0.0),
-        ("correct" if is_correct else "incorrect"),
-        is_correct,
-    )
-math_router = APIRouter()
-def _preview_tool_calls(tool_calls: Sequence[Mapping[str, Any]]) -> list[dict[str, Any]]:
-    """Return a compact, log-friendly preview of tool calls.
-    Truncates long fields to avoid noisy logs and leaking excessive content.
-    """
-    preview: list[dict[str, Any]] = []
-    for call in list(tool_calls or [])[:3]:
-        args = dict(call.get("args") or {})
-        answer = str(args.get("answer") or "")
-        # Hard truncate to keep logs compact
-        answer_short = answer[:120] + ("…" if len(answer) > 120 else "")
-        preview.append(
-            {
-                "tool": call.get("tool"),
-                "answer": answer_short,
-            }
-        )
-    return preview
-def _event_and_outcome_components(
-    tool_calls: Sequence[Mapping[str, Any]], *, correct: bool, reward: float
-) -> dict[str, float]:
-    """Approximate component-wise scores for RL-style logs.
-    - env:     task-level scalar reward (our single-step outcome)
-    - rubric_event: 1.0 if a valid tool call with non-empty answer was made else 0.0
-    - rubric_outcome: 1.0 if final answer was correct else 0.0
-    """
-    has_valid_tool = False
-    if tool_calls:
-        first = tool_calls[0] or {}
-        if str(first.get("tool") or "") == TOOL_NAME:
-            args = first.get("args") or {}
-            ans = str(args.get("answer") or "").strip()
-            has_valid_tool = bool(ans)
-    return {
-        "env": float(reward),
-        "rubric_event": 1.0 if has_valid_tool else 0.0,
-        "rubric_outcome": 1.0 if bool(correct) else 0.0,
-    }
-@math_router.post("/env/math/initialize")
-async def initialize_env(request: Request, payload: InitializePayload) -> dict[str, Any]:
-    manager: MathEnvironmentManager = request.app.state.math_env_manager
-    split = str(payload.config.get("split") or DEFAULT_SPLIT)
-    seed = payload.seed
-    index = None
-    if payload.config.get("index") is not None:
-        index = int(payload.config["index"])
-    state = manager.create(split=split, index=index, seed=seed)
-    return {
-        "env_id": state.env_id,
-        "observation": _observation_from_state(state),
-        "info": {"raw_solution": state.raw_solution},
-    }
-@math_router.post("/env/math/step")
-async def step_env(request: Request, payload: dict[str, Any]) -> dict[str, Any]:
-    manager: MathEnvironmentManager = request.app.state.math_env_manager
-    env_id = str(payload.get("env_id") or "")
-    if not env_id:
-        raise HTTPException(status_code=400, detail="env_id required")
-    try:
-        state = manager.get(env_id)
-    except KeyError as exc:  # pragma: no cover - defensive
-        raise HTTPException(status_code=404, detail=str(exc)) from exc
-    action = payload.get("action") or {}
-    tool_calls = action.get("tool_calls") or payload.get("tool_calls") or []
-    reward, status, correct = _score_submission(state, tool_calls)
-    with contextlib.suppress(Exception):
-        print(
-            "[MATH_STEP] env_id=",
-            state.env_id,
-            " split=",
-            state.split,
-            " index=",
-            state.index,
-            " calls=",
-            _preview_tool_calls(tool_calls),
-            " reward=",
-            reward,
-            " status=",
-            status,
-            " correct=",
-            correct,
-            " components=",
-            _event_and_outcome_components(tool_calls, correct=correct, reward=reward),
-            flush=True,
-        )
-    state.done = True
-    observation = _observation_from_state(state)
-    observation["status"] = status
-    return {
-        "observation": observation,
-        "done": True,
-        "reward": reward,
-        "info": {
-            "correct": correct,
-            "expected_answer": state.answer,
-            "raw_solution": state.raw_solution,
-        },
-    }
-@math_router.post("/env/math/terminate")
-async def terminate_env(request: Request, payload: dict[str, Any]) -> dict[str, Any]:
-    manager: MathEnvironmentManager = request.app.state.math_env_manager
-    env_id = str(payload.get("env_id") or "")
-    if env_id:
-        manager.terminate(env_id)
-    return {"ok": True}
-def _resolve_inference_url(base_url: str) -> str:
-    normalized = (base_url or "").rstrip("/")
-    if not normalized:
-        raise RuntimeError("policy.config.inference_url required")
-    if normalized.endswith("/v1/chat/completions"):
-        return normalized
-    if normalized.endswith("/chat/completions"):
-        return normalized
-    if normalized.endswith("/v1"):
-        return f"{normalized}/chat/completions"
-    return f"{normalized}/v1/chat/completions"
-async def _call_inference(
-    policy_config: Mapping[str, Any], observation: Mapping[str, Any]
-) -> tuple[list[dict[str, Any]], dict[str, Any]]:
-    inference_url = str(policy_config.get("inference_url") or "").rstrip("/")
-    if not inference_url:
-        raise RuntimeError("policy.config.inference_url required for rollout")
-    model = policy_config.get("model")
-    max_tokens = policy_config.get("max_tokens", 512)
-    temperature = policy_config.get("temperature", 0.0)
-    top_p = policy_config.get("top_p", 1.0)
-    messages = [
-        {
-            "role": "system",
-            "content": (
-                "You are a math solver. Read the problem carefully and respond with a single"
-                f" tool call using the function `{TOOL_NAME}`."
-                "\nRules:\n"
-                "- Do all reasoning internally.\n"
-                "- The tool call must include ONLY the final numeric or simplified answer in the"
-                " `answer` field.\n"
-                "- DO NOT include explanations, units, or extra text in the answer."
-            ),
-        },
-        {
-            "role": "user",
-            "content": (
-                "Problem:\n"
-                + str(observation.get("problem") or "")
-                + "\nSubmit the final answer via the tool call."
-            ),
-        },
-    ]
-    payload: dict[str, Any] = {
-        "model": model,
-        "messages": messages,
-        "tools": [
-            {
-                "type": "function",
-                "function": {
-                    "name": TOOL_NAME,
-                    "description": "Submit the final answer for the math problem.",
-                    "parameters": {
-                        "type": "object",
-                        "properties": {
-                            "answer": {
-                                "type": "string",
-                                "description": "Final answer in simplest form",
-                            },
-                            "explanation": {
-                                "type": "string",
-                                "description": "Optional explanation of reasoning",
-                            },
-                        },
-                        "required": ["answer"],
-                        "additionalProperties": False,
-                    },
-                },
-            }
-        ],
-        "tool_choice": {"type": "function", "function": {"name": TOOL_NAME}},
-        "temperature": temperature,
-        "top_p": top_p,
-        "max_tokens": max_tokens,
-    }
-    final_url = _resolve_inference_url(inference_url)
-    async with httpx.AsyncClient(timeout=httpx.Timeout(60.0)) as client:
-        response = await client.post(final_url, json=payload)
-    try:
-        data = response.json()
-    except Exception as exc:
-        raise http_exception(
-            502,
-            "inference_invalid_response",
-            "Inference provider returned invalid JSON",
-            extra={"body": response.text[:800]},
-        ) from exc
-    if response.status_code >= 500:
-        raise http_exception(
-            502,
-            "inference_upstream_error",
-            "Inference provider returned an error",
-            extra={"status": response.status_code, "body": data},
-        )
-    if response.status_code >= 400:
-        raise http_exception(
-            400,
-            "inference_request_invalid",
-            "Invalid inference request",
-            extra={"status": response.status_code, "body": data},
-        )
-    tool_calls = []
-    choices = data.get("choices") or []
-    if choices:
-        message = choices[0].get("message") or {}
-        raw_calls = message.get("tool_calls") or []
-        for call in raw_calls:
-            function = call.get("function") or {}
-            name = function.get("name")
-            arguments = function.get("arguments")
-            parsed_args: dict[str, Any]
-            if isinstance(arguments, str):
-                try:
-                    import json
-                    parsed_args = json.loads(arguments)
-                except Exception:
-                    parsed_args = {}
-            elif isinstance(arguments, MutableMapping):
-                parsed_args = dict(arguments)
-            else:
-                parsed_args = {}
-            tool_calls.append({"tool": name, "args": parsed_args})
-    # Lightweight provider-side logging
-    with contextlib.suppress(Exception):
-        print(
-            "[MATH_INFER] model=",
-            model,
-            " calls=",
-            _preview_tool_calls(tool_calls),
-            flush=True,
-        )
-    return tool_calls, data
-async def rollout_executor(request: RolloutRequest, fastapi_request: Request) -> RolloutResponse:
-    dataset: MathDataset = fastapi_request.app.state.math_dataset
-    split = str(((request.env.config or {}).get("split")) or DEFAULT_SPLIT)
-    sample = dataset.sample(split=split, index=request.env.seed)
-    observation = {
-        "problem": sample["problem"],
-        "split": sample["split"],
-        "index": sample["index"],
-    }
-    tool_calls: list[dict[str, Any]] = []
-    inference_payload: dict[str, Any] | None = None
-    error_info: dict[str, Any] = {}
-    try:
-        tool_calls, inference_payload = await _call_inference(
-            request.policy.config or {}, observation
-        )
-    except HTTPException as http_err:
-        tool_calls = []
-        error_info = {"error": http_err.detail, "code": http_err.status_code}
-    except Exception as exc:
-        tool_calls = []
-        error_info = {"error": str(exc)}
-    reward, status, correct = _score_submission(
-        MathEnvState(
-            env_id="rollout",
-            split=sample["split"],
-            index=sample["index"],
-            problem=sample["problem"],
-            answer=sample["answer"],
-            raw_solution=sample["raw_solution"],
-        ),
-        tool_calls,
-    )
-    # Log a concise summary so we can debug reward=0 issues in production
-    with contextlib.suppress(Exception):
-        print(
-            "[MATH_ROLLOUT] run=",
-            request.run_id,
-            " split=",
-            sample["split"],
-            " index=",
-            sample["index"],
-            " calls=",
-            _preview_tool_calls(tool_calls),
-            " reward=",
-            reward,
-            " status=",
-            status,
-            " correct=",
-            correct,
-            " components=",
-            _event_and_outcome_components(tool_calls, correct=correct, reward=reward),
-            flush=True,
-        )
-    step = RolloutStep(
-        obs=observation,
-        tool_calls=tool_calls,
-        reward=reward,
-        done=True,
-        info={
-            "expected_answer": sample["answer"],
-            "status": status,
-            "correct": correct,
-            "raw_solution": sample["raw_solution"],
-            "tool_call_preview": _preview_tool_calls(tool_calls),
-            **error_info,
-        },
-    )
-    trajectory = RolloutTrajectory(
-        env_id=f"math::{sample['split']}::{sample['index']}",
-        policy_id=request.policy.policy_id or "policy",
-        steps=[step],
-        final={
-            "observation": {**observation, "status": status},
-            "reward": reward,
-        },
-        length=1,
-    )
-    metrics = RolloutMetrics(
-        episode_returns=[reward],
-        mean_return=reward,
-        num_steps=1,
-        num_episodes=1,
-        outcome_score=reward,
-        events_score=reward,
-        details={"status": status, "correct": correct},
-    )
-    # Include a minimal trace when requested or tracing is enabled via env
-    include_trace = bool(
-        (request.record and getattr(request.record, "return_trace", False))
-        or os.getenv("TASKAPP_TRACING_ENABLED")
-    )
-    trace_payload = None
-    if include_trace:
-        try:
-            # Minimal structured trace for assertions
-            trace_payload = {
-                "session_id": str(uuid.uuid4()),
-                "events_count": 1,
-                "decision_rewards": [reward],
-                "lm_calls": (
-                    [{"prompt": str(observation.get("problem", "")), "response": str(tool_calls)}]
-                    if tool_calls
-                    else []
-                ),
-                "metadata": {
-                    "env": "math_single_step",
-                    "split": sample["split"],
-                    "index": sample["index"],
-                    "status": status,
-                },
-            }
-        except Exception:
-            trace_payload = None
-    return RolloutResponse(
-        run_id=request.run_id,
-        trajectories=[trajectory],
-        branches={},
-        metrics=metrics,
-        aborted=False,
-        ops_executed=2,
-        trace=trace_payload,
-    )
-def build_dataset() -> tuple[TaskDatasetRegistry, MathDataset]:
-    registry = TaskDatasetRegistry()
-    dataset = MathDataset(name=DATASET_NAME, config=DATASET_CONFIG, splits=AVAILABLE_SPLITS)
-    # Ensure default split is available when the task app boots
-    try:
-        dataset.ensure_ready([DEFAULT_SPLIT])
-    except Exception as exc:
-        raise RuntimeError(
-            "Failed to initialise math dataset. Set MATH_DATASET_LOCAL_DIR or ensure network access.\n"
-            f"Underlying error: {exc}"
-        ) from exc
-    registry.register(MATH_DATASET_SPEC, lambda _spec: dataset, cache=True)
-    return registry, dataset
-def _base_task_info() -> TaskInfo:
-    return TaskInfo(
-        task={"id": "math_single_step", "name": "Math Single Step", "version": "1.0.0"},
-        environments=["math"],
-        action_space={
-            "type": "tool_call",
-            "tools": [
-                {
-                    "name": TOOL_NAME,
-                    "description": "Submit the final answer for the math problem.",
-                    "schema": {"answer": "string"},
-                }
-            ],
-            "max_calls": 1,
-        },
-        observation={
-            "summary": "Single math word problem presented as plain text.",
-            "keys": ["problem"],
-        },
-        dataset={
-            **MATH_DATASET_SPEC.model_dump(),
-            "hf_dataset": DATASET_NAME,
-            "hf_config": DATASET_CONFIG,
-        },
-        rubric={
-            "version": "1",
-            "criteria_count": 1,
-            "source": "inline",
-        },
-        inference={
-            "supports_proxy": True,
-            "tool": {"name": TOOL_NAME, "parallel_tool_calls": False},
-        },
-        capabilities={
-            "supports_rollout": True,
-            "supports_env_lifecycle": True,
-            "requires_api_key_header": True,
-        },
-        limits={"max_turns": 1},
-    )
-OUTCOME_RUBRIC: Rubric = cast(
-    Rubric,
-    load_rubric(
-        {
-            "version": "1",
-            "goal_text": "Encourage correct single-step math answers via tool calls.",
-            "aggregation": "weighted_sum",
-            "criteria": [
-                {
-                    "id": "correct_answer",
-                    "description": "Submit the correct final answer using the math_submit tool.",
-                    "weight": 1.0,
-                }
-            ],
-        }
-    ),
-)
-EVENTS_RUBRIC: Rubric = cast(
-    Rubric,
-    load_rubric(
-        {
-            "version": "1",
-            "goal_text": "Penalize missing or malformed tool calls.",
-            "aggregation": "weighted_sum",
-            "criteria": [
-                {
-                    "id": "tool_usage",
-                    "description": "Make exactly one tool call with an answer string.",
-                    "weight": 1.0,
-                }
-            ],
-        }
-    ),
-)
-def describe_taskset(dataset: MathDataset) -> dict[str, Any]:
-    return {
-        **MATH_DATASET_SPEC.model_dump(),
-        "hf_dataset": DATASET_NAME,
-        "hf_config": DATASET_CONFIG,
-        "sizes": {split: dataset.size(split) for split in dataset.splits},
-    }
-def provide_task_instances(dataset: MathDataset, seeds: Sequence[int]) -> Iterable[TaskInfo]:
-    info = _base_task_info()
-    for seed in seeds:
-        sample = dataset.sample(split=DEFAULT_SPLIT, index=seed)
-        yield TaskInfo(
-            task=info.task,
-            environments=info.environments,
-            action_space=info.action_space,
-            observation={**info.observation, "sample_index": sample["index"]},
-            dataset={
-                **info.dataset,
-                "split": sample["split"],
-                "index": sample["index"],
-            },
-            rubric=info.rubric,
-            inference=info.inference,
-            capabilities=info.capabilities,
-            limits=info.limits,
-        )
-def build_config() -> TaskAppConfig:
-    registry, dataset = build_dataset()
-    base_info = _base_task_info()
-    tracing_enabled = tracing_env_enabled()
-    tracing_db_url = resolve_tracing_db_url()
-    tracer_factory = build_tracer_factory(
-        SessionTracer, enabled=tracing_enabled, db_url=tracing_db_url
-    )
-    sft_output_dir = resolve_sft_output_dir()
-    app_state: dict[str, Any] = {
-        "math_dataset": dataset,
-        "math_env_manager": MathEnvironmentManager(dataset),
-        "tracing_enabled": tracing_enabled,
-    }
-    if tracer_factory is not None:
-        app_state["session_tracer_factory"] = tracer_factory
-    if sft_output_dir:
-        app_state["sft_output_dir"] = sft_output_dir
-    proxy_keys = normalize_vendor_keys()
-    openai_key = proxy_keys.get("OPENAI_API_KEY")
-    groq_key = proxy_keys.get("GROQ_API_KEY")
-    proxy_config = ProxyConfig(
-        enable_openai=openai_key is not None,
-        enable_groq=groq_key is not None,
-        system_hint=(
-            "You must respond with a single math_submit tool call containing only the final answer."
-        ),
-    )
-    config = TaskAppConfig(
-        app_id="math-single-step",
-        name="Math Single Step Task",
-        description="Single-step math reasoning environment built on the MATH dataset.",
-        base_task_info=base_info,
-        describe_taskset=lambda: describe_taskset(dataset),
-        provide_task_instances=lambda seeds: provide_task_instances(dataset, seeds),
-        rollout=rollout_executor,
-        dataset_registry=registry,
-        rubrics=RubricBundle(outcome=OUTCOME_RUBRIC, events=EVENTS_RUBRIC),
-        proxy=proxy_config,
-        routers=(math_router,),
-        app_state=app_state,
-        cors_origins=["*"],
-    )
-    return config
-register_task_app(
-    entry=TaskAppEntry(
-        app_id="math-single-step",
-        description="Single-step math reasoning task app using EleutherAI/math dataset.",
-        config_factory=build_config,
-        aliases=("math-rl",),
-        env_files=("examples/rl/.env",),
-        modal=ModalDeploymentConfig(
-            app_name="synth-math-single-step",
-            pip_packages=(
-                "datasets>=4.0.0",
-                "fastapi>=0.115.0",
-                "pydantic>=2.0.0",
-                "httpx>=0.26.0",
-                "requests>=2.32.0",
-                "python-dotenv>=1.0.0",
-                "diskcache>=5.6.3",
-                "duckdb>=1.0.0",
-                "ty>=0.0.1a5",
-                "toml>=0.10.2",
-                "aiosqlite>=0.21.0",
-                "libsql>=0.1.8",
-                "pynacl>=1.5.0",
-                "sqlalchemy>=2.0.42",
-            ),
-            extra_local_dirs=(
-                (str(REPO_ROOT / "synth_ai"), "/opt/synth_ai_repo/synth_ai"),
-                (str(REPO_ROOT / "examples" / "rl"), "/opt/synth_ai_repo/examples/rl"),
-            ),
-            volume_mounts=(("math-dataset-cache", "/modal_volumes/math_dataset"),),
-        ),
-    )
-)

synth-ai 0.2.9.dev11__py3-none-any.whl → 0.4.1__py3-none-any.whl

Potentially problematic release.

synth-ai 0.2.9.dev11py3-none-any.whl → 0.4.1py3-none-any.whl