From 208f2e06152383b56ca596066f4681ae8bd714ef Mon Sep 17 00:00:00 2001 From: "my.nguyen" Date: Thu, 13 Aug 2026 12:32:00 +0700 Subject: [PATCH] fix(gooddata-eval): set temperature=0 for all simulated users --- .../gooddata-eval/src/gooddata_eval/core/agentic/alert_skill.py | 2 +- .../src/gooddata_eval/core/agentic/conversation.py | 2 +- .../gooddata-eval/src/gooddata_eval/core/agentic/kda_skill.py | 1 + .../src/gooddata_eval/core/agentic/metric_skill.py | 1 + .../src/gooddata_eval/core/agentic/visualization.py | 2 +- 5 files changed, 5 insertions(+), 3 deletions(-) diff --git a/packages/gooddata-eval/src/gooddata_eval/core/agentic/alert_skill.py b/packages/gooddata-eval/src/gooddata_eval/core/agentic/alert_skill.py index 42ce9f3ec..3583780bd 100644 --- a/packages/gooddata-eval/src/gooddata_eval/core/agentic/alert_skill.py +++ b/packages/gooddata-eval/src/gooddata_eval/core/agentic/alert_skill.py @@ -250,7 +250,7 @@ def generate_simulated_alert_response( response = openai_client.chat.completions.create( model="gpt-4o", messages=messages, - temperature=0.5, + temperature=0, ) return response.choices[0].message.content or "" diff --git a/packages/gooddata-eval/src/gooddata_eval/core/agentic/conversation.py b/packages/gooddata-eval/src/gooddata_eval/core/agentic/conversation.py index a7c3034fe..6d5fa4613 100644 --- a/packages/gooddata-eval/src/gooddata_eval/core/agentic/conversation.py +++ b/packages/gooddata-eval/src/gooddata_eval/core/agentic/conversation.py @@ -252,7 +252,7 @@ def _get_sim_user_response(agent_message: str, turn: TurnDefinition, expected_ou ), }, ], - temperature=0.5, + temperature=0, ) content = response.choices[0].message.content return content.strip() if content else "Please proceed with sensible defaults." diff --git a/packages/gooddata-eval/src/gooddata_eval/core/agentic/kda_skill.py b/packages/gooddata-eval/src/gooddata_eval/core/agentic/kda_skill.py index f621afa27..32345bde8 100644 --- a/packages/gooddata-eval/src/gooddata_eval/core/agentic/kda_skill.py +++ b/packages/gooddata-eval/src/gooddata_eval/core/agentic/kda_skill.py @@ -71,6 +71,7 @@ def generate_simulated_kda_response(agent_message: str, measure_candidates: dict model="gpt-4o-mini", messages=[{"role": "user", "content": prompt}], max_tokens=150, + temperature=0, timeout=30, ) return response.choices[0].message.content or "Please proceed with either option." diff --git a/packages/gooddata-eval/src/gooddata_eval/core/agentic/metric_skill.py b/packages/gooddata-eval/src/gooddata_eval/core/agentic/metric_skill.py index 2e2b5b9b1..8e78a3acf 100644 --- a/packages/gooddata-eval/src/gooddata_eval/core/agentic/metric_skill.py +++ b/packages/gooddata-eval/src/gooddata_eval/core/agentic/metric_skill.py @@ -95,6 +95,7 @@ def generate_simulated_response(agent_message: str, expected_output: dict) -> st model="gpt-4o-mini", messages=[{"role": "user", "content": prompt}], max_tokens=150, + temperature=0, ) return response.choices[0].message.content or "Please proceed." diff --git a/packages/gooddata-eval/src/gooddata_eval/core/agentic/visualization.py b/packages/gooddata-eval/src/gooddata_eval/core/agentic/visualization.py index 18656e30c..3548b22b7 100644 --- a/packages/gooddata-eval/src/gooddata_eval/core/agentic/visualization.py +++ b/packages/gooddata-eval/src/gooddata_eval/core/agentic/visualization.py @@ -141,7 +141,7 @@ def generate_simulated_response(agent_message: str, expected_output: CreatedVisu ), }, ], - temperature=0.5, + temperature=0, ) content = response.choices[0].message.content return content.strip() if content else ""