собственный rl-агент «pizzabrain»
попытка собрать свой аналог нитрогена с памятью: dinov3 + transformer-стек кадров + action chunking. обучение через ppo на ферме из 8 окон со спидхаком и своим модом для игры.
reinforcement learning action chunking game modding