rlQAgent

Создайте агента обучения с подкреплением Q-изучения

Синтаксис

agent = rlQAgent(critic)

agent = rlQAgent(critic,opt)

Описание

agent = rlQAgent(critic) создает агента Q-изучения с опциями по умолчанию и заданным представлением критика. Для получения дополнительной информации об агентах Q-изучения смотрите Агентов Q-изучения.

пример

agent = rlQAgent(critic,opt) создает агента Q-изучения с помощью заданных опций агента, чтобы заменить значения по умолчанию агента.

Примеры

свернуть все

Создайте агента Q-изучения

Создайте интерфейс среды.

env = rlPredefinedEnv("BasicGridWorld");

Создайте представление функции значения критика с помощью Q-таблицы, выведенной из наблюдения среды и спецификаций действия.

qTable = rlTable(getObservationInfo(env),getActionInfo(env));
critic = rlRepresentation(qTable);

Создайте агента Q-изучения с помощью заданной функции значения критика и значения эпсилона 0.05.

opt = rlQAgentOptions;
opt.EpsilonGreedyExploration.Epsilon = 0.05;
agent = rlQAgent(critic,opt);

Входные параметры

свернуть все

`critic` — Представление сети Critic
`rlTableRepresentation` объект

Представление сети Critic, заданное как rlTableRepresentation объект, созданный с помощью rlRepresentation. Для получения дополнительной информации о создании представлений критика смотрите, Создают политику и Представления Функции Значения.

`opt` — Опции агента
`rlQAgentOptions` объект

Опции агента, заданные как rlQAgentOptions объект.

Выходные аргументы

свернуть все

`agent` — Агент Q-изучения
`rlQAgent` объект

Агент Q-изучения, возвращенный как rlQAgent объект.

Смотрите также

Функции

rlQAgentOptions | train

Темы

Введенный в R2019a

Документация Reinforcement Learning Toolbox

Поддержка

Памятка переводчика

1. Если смысл перевода понятен, то лучше оставьте как есть и не придирайтесь к словам, синонимам и тому подобному. О вкусах не спорим.

2. Не дополняйте перевод комментариями “от себя”. В исправлении не должно появляться дополнительных смыслов и комментариев, отсутствующих в оригинале. Такие правки не получится интегрировать в алгоритме автоматического перевода.

3. Сохраняйте структуру оригинального текста - например, не разбивайте одно предложение на два.

4. Не имеет смысла однотипное исправление перевода какого-то термина во всех предложениях. Исправляйте только в одном месте. Когда Вашу правку одобрят, это исправление будет алгоритмически распространено и на другие части документации.

5. По иным вопросам, например если надо исправить заблокированное для перевода слово, обратитесь к редакторам через форму технической поддержки.

Документация

rlQAgent

Синтаксис

Описание

Примеры

Создайте агента Q-изучения

Входные параметры

critic — Представление сети Critic rlTableRepresentation объект

opt — Опции агента rlQAgentOptions объект

Выходные аргументы

agent — Агент Q-изучения rlQAgent объект

Смотрите также

Функции

Темы

Введенный в R2019a

Документация Reinforcement Learning Toolbox

Поддержка

`critic` — Представление сети Critic
`rlTableRepresentation` объект

`opt` — Опции агента
`rlQAgentOptions` объект

`agent` — Агент Q-изучения
`rlQAgent` объект