Статья
Обучение с подкреплением
Как обучать агента, который принимает последовательность решений и получает только отложенную награду: марковские процессы, уравнения Беллмана, Q-learning и SARSA, …
1 материалов в этой теме.
Как обучать агента, который принимает последовательность решений и получает только отложенную награду: марковские процессы, уравнения Беллмана, Q-learning и SARSA, …
По этому запросу ничего не найдено.