MORAD-RNA/MORAD-RIDE
Reinforcement Learning • Updated
RNA inverse design, reinforcement learning, diffusion models
Reinforcement Learning with Multi-Objective Rewards for RNA Inverse Design
MORAD post-trains a single backbone-conditioned RNA diffusion policy online with a six-objective reward covering tertiary geometry, base pairing, ensemble behavior and sequence composition. The trained policy designs sequences for a new target backbone directly, with no per-target optimization.