laion/tasktrove-dq-tulu3-personas-math-step13-30b-a3b
Reinforcement Learning • 31B • Updated
open multi-modal foundation models and datasets for their creation; scaling laws, model evaluation; fully local, sovereign model deployment, personalized assistants and open local agentic systems