Nステップ先まで再帰的に想像する損失を実装した ImaginingForwardDynamicsTrainerを実装
## 概要
Nステップ先まで再帰的に想像し、より長期予測を可能にするための損失を実装した ImaginingForwardDynamicsTrainerを実装しました。
主に `train`メソッドの中身を確認していただけるとありがたいです。
もう少し説明が必要であればコメントお願いします。
### 参考
https://github.com/MLShukai/ami-theory/blob/main/dist/long_span_prediction_reward.pdf
## Submit前の確認項目
<!-- PRをSubmitする前に確認する項目 -->
- [x] タイトルは一目でわかるようにし、説明文は PR を簡潔に説明するようにしましたか?
- [x] あなたの PR が、異なる変更を束ねたものではなく、ひとつのことだけを行うものであることを確認しましたか?
- [x] この PR で導入されたすべての変更点をリストアップしましたか?
- [x] PR を`make run`コマンドでローカルでテストしましたか?
## 補足
<!-- レビューをする際に見てほしい点、ローカル環境で試す際の注意点、など -->
合并状态:已合并 合并于 2025-03-13 关闭于 2025-03-13 1 条评论