← Product catalog
Source publisher

tvrpranay

This owner's products in the Peerivo catalog.

Open owner's website ↗

Products 18

ModelНе подтверждена

tvrpranay/a2c-PandaReachDense-v3

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay
ModelНе подтверждена

tvrpranay/doom_health_gathering_supreme

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay
ModelНе подтверждена

tvrpranay/dqn-SpaceInvadersNoFrameskip-v4

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay
ModelНе подтверждена

tvrpranay/ML-Agents-SoccerTwos

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay
ModelНе подтверждена

tvrpranay/poca-SoccerTwos

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay
ModelНе подтверждена

tvrpranay/ppo-LunarLander-v2

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay
ModelНе подтверждена

tvrpranay/ppo-LunarLander-v2-pytorch

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay
ModelНе подтверждена

tvrpranay/ppo-Pyramids

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay
ModelНе подтверждена

tvrpranay/ppo-SnowballTarget

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay
ModelНе подтверждена

tvrpranay/ppo-SoccerTwos

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay
ModelНе подтверждена

tvrpranay/q-Taxi-v3

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay
ModelНе подтверждена

tvrpranay/reinforce-CartPole-v1

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay
ModelНе подтверждена

tvrpranay/reinforce-Pixelcopter-PL-v0

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay
ModelНе подтверждена

tvrpranay/reinforce-Pixelcopter-PLE-v0

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay
ModelНе подтверждена

tvrpranay/sample-factory-doom-health-gathering

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay
ModelНе подтверждена

tvrpranay/sf-doom_health_gathering_supreme

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay
ModelНе подтверждена

tvrpranay/sf-doom-health-gathering

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay
ModelНе подтверждена

tvrpranay/SoccerTwos

Модель поведения агента: используется для выбора действий в среде в задачах обучения с подкреплением.

Owner / publishertvrpranay