Skip to content

simulo.Policy

The policy contract: a callable that maps observations to actions.

A policy is used both during evaluation/playback (a simulo.Player drives it) and for deployment. Calls are vectorized — a batch of observations in, a batch of actions out.

Structural mirror of simulo.core.policy.Policy.

Policy.input_dim: Optional[int]

property

Expected observation width, or None when the policy does not declare one.

Policy.output_dim: Optional[int]

property

Produced action width, or None when the policy does not declare one.

Policy.__call__(observation: TensorLike) -> TensorLike

Map an observation batch (num_envs, input_dim) to actions (num_envs, output_dim).


Declared as:

@runtime_checkable
class PolicyProtocol(Protocol)