Reinforcement Learning в алготрейдинге: архитектура памяти состояний, Q-learning и стационарные признаки
Инженерный разбор RL-систем для финансовых рынков: квантование состояний в нейроны памяти, z-score инварианты, Q-learning и ансамблевый Collective Mind.