Aislinnliu
Aislinn
ยท
AI & ML interests
None yet
Recent Activity
upvoted a paper 2 days ago
MiMo-V2.6: Scaling Reinforcement Learning Towards Self-Improvement upvoted a collection 20 days ago
MiMo-V2.6 upvoted a paper over 1 year ago
EPO: Explicit Policy Optimization for Strategic Reasoning in LLMs via
Reinforcement Learning