Allow reduced latent sde dim
This commit is contained in:
@@ -100,6 +100,7 @@ class ActorCriticPolicy(BasePolicy):
|
||||
optimizer_kwargs: Optional[Dict[str, Any]] = None,
|
||||
dist_kwargs: Optional[Dict[str, Any]] = None,
|
||||
sqrt_induced_gaussian: bool = False,
|
||||
latent_dim_sde=None,
|
||||
):
|
||||
|
||||
if optimizer_kwargs is None:
|
||||
@@ -155,6 +156,7 @@ class ActorCriticPolicy(BasePolicy):
|
||||
self.dist_kwargs = dist_kwargs
|
||||
|
||||
self.sqrt_induced_gaussian = sqrt_induced_gaussian
|
||||
self.latent_dim_sde = latent_dim_sde
|
||||
|
||||
# Action distribution
|
||||
self.action_dist = make_proba_distribution(
|
||||
@@ -244,7 +246,7 @@ class ActorCriticPolicy(BasePolicy):
|
||||
latent_dim=latent_dim_pi)
|
||||
elif isinstance(self.action_dist, UniversalGaussianDistribution):
|
||||
self.action_net, self.chol_net = self.action_dist.proba_distribution_net(
|
||||
latent_dim=latent_dim_pi, latent_sde_dim=latent_dim_pi, std_init=math.exp(
|
||||
latent_dim=latent_dim_pi, latent_sde_dim=self.latent_dim_sde or latent_dim_pi, std_init=math.exp(
|
||||
self.log_std_init)
|
||||
)
|
||||
else:
|
||||
|
||||
Reference in New Issue
Block a user