DTLoss¶
- class torchrl.objectives.DTLoss(*args, **kwargs)[原始碼]¶
TorchRL 對線上決策 Transformer 損失的實現。
在 “Decision Transformer: Reinforcement Learning via Sequence Modeling” <https://arxiv.org/abs/2106.01345> 中提出
- 引數:
actor_network (ProbabilisticActor) – 隨機策略
- 關鍵字引數:
loss_function (str) – 要使用的損失函式。預設為
"l2"。reduction (str, optional) – 指定應用於輸出的約簡:
"none"|"mean"|"sum"。"none":不應用約簡,"mean":輸出的總和將除以輸出中的元素數量,"sum":將對輸出進行求和。預設為"mean"。
- default_keys¶
別名:
_AcceptedKeys