simulo.Policy
The policy contract: a callable that maps observations to actions.
A policy is used both during evaluation/playback (a simulo.Player drives
it) and for deployment. Calls are vectorized — a batch of observations in,
a batch of actions out.
Structural mirror of simulo.core.policy.Policy.
input_dim
Section titled “input_dim”Policy.input_dim: Optional[int]property
Expected observation width, or None when the policy does not declare one.
output_dim
Section titled “output_dim”Policy.output_dim: Optional[int]property
Produced action width, or None when the policy does not declare one.
__call__()
Section titled “__call__()”Policy.__call__(observation: TensorLike) -> TensorLikeMap an observation batch (num_envs, input_dim) to actions (num_envs, output_dim).
Declared as:
@runtime_checkableclass PolicyProtocol(Protocol)