agent = rlPPOAgent(actor,critic,opt) создает агента ближайшей оптимизации политики (PPO) с заданным агентом и сетями критика, с помощью заданных опций агента PPO. Для получения дополнительной информации об агентах PPO смотрите Ближайших Агентов Оптимизации политики.
actor — Представление сети Actor rlLayerRepresentation возразите | rlDLNetworkRepresentation объект
Представление сети Actor для представления политики, заданной как любой rlLayerRepresentation или rlDLNetworkRepresentation объект, созданный с помощью rlRepresentation. Для получения дополнительной информации о создании представлений агента смотрите, Создают политику и Представления Функции Значения.
critic — Представление сети Critic rlLayerRepresentation возразите | rlDLNetworkRepresentation объект
Представление сети Critic для оценки функции значения состояния, заданной как любой rlLayerRepresentation или rlDLNetworkRepresentation объект, созданный с помощью rlRepresentation. Для получения дополнительной информации о создании представлений критика смотрите, Создают политику и Представления Функции Значения.
Для просмотра документации необходимо авторизоваться на сайте
Памятка переводчика
1. Если смысл перевода понятен, то лучше оставьте как есть и не придирайтесь к словам, синонимам и тому подобному. О вкусах не спорим.
2. Не дополняйте перевод комментариями “от себя”. В исправлении не должно появляться дополнительных смыслов и комментариев, отсутствующих в оригинале. Такие правки не получится интегрировать в алгоритме автоматического перевода.
3. Сохраняйте структуру оригинального текста - например, не разбивайте одно предложение на два.
4. Не имеет смысла однотипное исправление перевода какого-то термина во всех предложениях. Исправляйте только в одном месте. Когда Вашу правку одобрят, это исправление будет алгоритмически распространено и на другие части документации.
5. По иным вопросам, например если надо исправить заблокированное для перевода слово, обратитесь к редакторам через форму технической поддержки.