mirror of
https://github.com/huggingface/lerobot.git
synced 2026-07-21 08:51:47 +00:00
fix: include IS_INTERVENTION in complementary_info sent to learner for offline replay buffer
This commit is contained in:
@@ -327,7 +327,8 @@ def act_with_policy(
|
|||||||
|
|
||||||
# Check for intervention from transition info
|
# Check for intervention from transition info
|
||||||
intervention_info = new_transition[TransitionKey.INFO]
|
intervention_info = new_transition[TransitionKey.INFO]
|
||||||
if intervention_info.get(TeleopEvents.IS_INTERVENTION, False):
|
is_intervention = intervention_info.get(TeleopEvents.IS_INTERVENTION, False)
|
||||||
|
if is_intervention:
|
||||||
episode_intervention = True
|
episode_intervention = True
|
||||||
episode_intervention_steps += 1
|
episode_intervention_steps += 1
|
||||||
|
|
||||||
@@ -335,6 +336,7 @@ def act_with_policy(
|
|||||||
"discrete_penalty": torch.tensor(
|
"discrete_penalty": torch.tensor(
|
||||||
[new_transition[TransitionKey.COMPLEMENTARY_DATA].get("discrete_penalty", 0.0)]
|
[new_transition[TransitionKey.COMPLEMENTARY_DATA].get("discrete_penalty", 0.0)]
|
||||||
),
|
),
|
||||||
|
TeleopEvents.IS_INTERVENTION: is_intervention,
|
||||||
}
|
}
|
||||||
# Create transition for learner (convert to old format)
|
# Create transition for learner (convert to old format)
|
||||||
list_transition_to_send_to_learner.append(
|
list_transition_to_send_to_learner.append(
|
||||||
|
|||||||
Reference in New Issue
Block a user