gooddata-eval 1.72.1.dev4__tar.gz → 1.72.1.dev5__tar.gz

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (89) hide show
  1. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/PKG-INFO +2 -2
  2. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/pyproject.toml +2 -2
  3. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/agentic/alert_skill.py +1 -1
  4. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/agentic/conversation.py +1 -1
  5. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/agentic/kda_skill.py +1 -0
  6. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/agentic/metric_skill.py +1 -0
  7. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/agentic/visualization.py +1 -1
  8. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/.gitignore +0 -0
  9. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/LICENSE.txt +0 -0
  10. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/Makefile +0 -0
  11. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/README.md +0 -0
  12. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/__init__.py +0 -0
  13. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/_version.py +0 -0
  14. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/cli/__init__.py +0 -0
  15. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/cli/agentic_runner.py +0 -0
  16. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/cli/main.py +0 -0
  17. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/__init__.py +0 -0
  18. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/agentic/__init__.py +0 -0
  19. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/agentic/_catalog.py +0 -0
  20. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/agentic/_langfuse.py +0 -0
  21. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/agentic/general_question.py +0 -0
  22. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/agentic/guardrail.py +0 -0
  23. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/agentic/search_tool.py +0 -0
  24. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/chat/__init__.py +0 -0
  25. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/chat/sse_client.py +0 -0
  26. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/config.py +0 -0
  27. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/connection.py +0 -0
  28. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/dataset/__init__.py +0 -0
  29. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/dataset/langfuse_source.py +0 -0
  30. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/dataset/local.py +0 -0
  31. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/evaluators/__init__.py +0 -0
  32. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/evaluators/_deep_subset.py +0 -0
  33. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/evaluators/_llm_judge.py +0 -0
  34. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/evaluators/_text_utils.py +0 -0
  35. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/evaluators/alert_skill.py +0 -0
  36. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/evaluators/base.py +0 -0
  37. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/evaluators/general_question.py +0 -0
  38. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/evaluators/guardrail.py +0 -0
  39. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/evaluators/metric_skill.py +0 -0
  40. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/evaluators/search_tool.py +0 -0
  41. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/evaluators/summary.py +0 -0
  42. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/evaluators/visualization.py +0 -0
  43. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/langfuse/__init__.py +0 -0
  44. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/langfuse/sink.py +0 -0
  45. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/models.py +0 -0
  46. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/reporting/__init__.py +0 -0
  47. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/reporting/console.py +0 -0
  48. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/reporting/json_report.py +0 -0
  49. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/runner.py +0 -0
  50. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/scoring.py +0 -0
  51. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/summary/__init__.py +0 -0
  52. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/summary/http_client.py +0 -0
  53. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/src/gooddata_eval/core/workspace.py +0 -0
  54. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/__init__.py +0 -0
  55. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/conftest.py +0 -0
  56. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/fixtures/sample_dataset/metric_skill_create.json +0 -0
  57. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/fixtures/sample_dataset/visualization_revenue.json +0 -0
  58. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/fixtures/sse_visualization_stream.txt +0 -0
  59. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_agentic_alert_skill.py +0 -0
  60. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_agentic_conversation.py +0 -0
  61. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_agentic_general_question.py +0 -0
  62. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_agentic_guardrail.py +0 -0
  63. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_agentic_kda_skill.py +0 -0
  64. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_agentic_langfuse_trace.py +0 -0
  65. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_agentic_metric_skill.py +0 -0
  66. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_agentic_run_context.py +0 -0
  67. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_agentic_search_tool.py +0 -0
  68. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_agentic_visualization.py +0 -0
  69. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_alert_skill_evaluator.py +0 -0
  70. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_cli.py +0 -0
  71. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_connection.py +0 -0
  72. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_deep_subset.py +0 -0
  73. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_langfuse_sink.py +0 -0
  74. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_langfuse_source.py +0 -0
  75. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_llm_judge.py +0 -0
  76. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_local_loader.py +0 -0
  77. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_metric_skill_evaluator.py +0 -0
  78. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_models.py +0 -0
  79. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_reporting.py +0 -0
  80. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_runner.py +0 -0
  81. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_scoring.py +0 -0
  82. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_search_tool_evaluator.py +0 -0
  83. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_sse_client.py +0 -0
  84. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_summary_client.py +0 -0
  85. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_summary_evaluator.py +0 -0
  86. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_text_evaluators.py +0 -0
  87. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_visualization_evaluator.py +0 -0
  88. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tests/test_workspace.py +0 -0
  89. {gooddata_eval-1.72.1.dev4 → gooddata_eval-1.72.1.dev5}/tox.ini +0 -0
@@ -1,6 +1,6 @@
1
1
  Metadata-Version: 2.5
2
2
  Name: gooddata-eval
3
- Version: 1.72.1.dev4
3
+ Version: 1.72.1.dev5
4
4
  Summary: Evaluate the GoodData AI agent against your own questions and models.
5
5
  Project-URL: Source, https://github.com/gooddata/gooddata-python-sdk
6
6
  Author-email: GoodData <support@gooddata.com>
@@ -17,7 +17,7 @@ Classifier: Topic :: Scientific/Engineering
17
17
  Classifier: Topic :: Software Development
18
18
  Classifier: Typing :: Typed
19
19
  Requires-Python: >=3.10
20
- Requires-Dist: gooddata-sdk~=1.72.1.dev4
20
+ Requires-Dist: gooddata-sdk~=1.72.1.dev5
21
21
  Requires-Dist: httpx<1.0,>=0.27
22
22
  Requires-Dist: orjson<4.0.0,>=3.9.15
23
23
  Requires-Dist: pydantic<3.0,>=2.6
@@ -1,7 +1,7 @@
1
1
  # (C) 2026 GoodData Corporation
2
2
  [project]
3
3
  name = "gooddata-eval"
4
- version = "1.72.1.dev4"
4
+ version = "1.72.1.dev5"
5
5
  description = "Evaluate the GoodData AI agent against your own questions and models."
6
6
  readme = "README.md"
7
7
  license = "MIT"
@@ -11,7 +11,7 @@ authors = [
11
11
  keywords = ["gooddata", "ai", "evaluation", "llm", "analytics", "cli"]
12
12
  requires-python = ">=3.10"
13
13
  dependencies = [
14
- "gooddata-sdk~=1.72.1.dev4",
14
+ "gooddata-sdk~=1.72.1.dev5",
15
15
  "httpx>=0.27,<1.0",
16
16
  "orjson>=3.9.15,<4.0.0",
17
17
  "pydantic>=2.6,<3.0",
@@ -250,7 +250,7 @@ def generate_simulated_alert_response(
250
250
  response = openai_client.chat.completions.create(
251
251
  model="gpt-4o",
252
252
  messages=messages,
253
- temperature=0.5,
253
+ temperature=0,
254
254
  )
255
255
  return response.choices[0].message.content or ""
256
256
 
@@ -252,7 +252,7 @@ def _get_sim_user_response(agent_message: str, turn: TurnDefinition, expected_ou
252
252
  ),
253
253
  },
254
254
  ],
255
- temperature=0.5,
255
+ temperature=0,
256
256
  )
257
257
  content = response.choices[0].message.content
258
258
  return content.strip() if content else "Please proceed with sensible defaults."
@@ -103,6 +103,7 @@ def generate_simulated_kda_response(
103
103
  model="gpt-4o-mini",
104
104
  messages=[{"role": "user", "content": prompt}],
105
105
  max_tokens=150,
106
+ temperature=0,
106
107
  timeout=30,
107
108
  )
108
109
  return response.choices[0].message.content or "Please proceed with either option."
@@ -95,6 +95,7 @@ def generate_simulated_response(agent_message: str, expected_output: dict) -> st
95
95
  model="gpt-4o-mini",
96
96
  messages=[{"role": "user", "content": prompt}],
97
97
  max_tokens=150,
98
+ temperature=0,
98
99
  )
99
100
  return response.choices[0].message.content or "Please proceed."
100
101
 
@@ -141,7 +141,7 @@ def generate_simulated_response(agent_message: str, expected_output: CreatedVisu
141
141
  ),
142
142
  },
143
143
  ],
144
- temperature=0.5,
144
+ temperature=0,
145
145
  )
146
146
  content = response.choices[0].message.content
147
147
  return content.strip() if content else ""