This commit is contained in:
Pepijn
2025-08-31 21:47:11 +02:00
parent d51bbe9492
commit d6a24e2882
@@ -758,7 +758,7 @@ class RLearNPolicy(PreTrainedPolicy):
# For longer sequences, show first 8 and last 8
print(f" Targets: {sample_targets[:8]} ... {sample_targets[-8:]}")
print(f" Preds: {sample_preds[:8]} ... {sample_preds[-8:]}")
else:
print(f"Sample {sample_idx}: T_eff={T_eff}, target ∈ [{sample_targets.min():.3f}, {sample_targets.max():.3f}], pred ∈ [{sample_preds.min():.3f}, {sample_preds.max():.3f}]")
print(f"Loss: {loss:.6f}")