Download server/support_ops_env/reward.py from dbatcode28/supportOpsEnv: direct link, hf CLI and curl.
- Browser
- Download file 324 Bytes
-
https://huggingface.co/dbatcode28/supportOpsEnv/resolve/main/server/support_ops_env/reward.py
- Command line
-
hf download hf://dbatcode28/supportOpsEnv/server/support_ops_env/reward.py
-
curl -L -o reward.py https://huggingface.co/dbatcode28/supportOpsEnv/resolve/main/server/support_ops_env/reward.py
324 Bytes
| from __future__ import annotations | |
| from typing import Dict | |
| from .models import RewardModel | |
| STEP_PENALTY = -0.01 | |
| def build_reward(components: Dict[str, float], rationale: str) -> RewardModel: | |
| value = round(sum(components.values()), 4) | |
| return RewardModel(value=value, components=components, rationale=rationale) | |