由 mll-lab-nu 提供
Agent RL framework for LLM agents: multi-turn reinforcement learning with StarPO and reasoning-collapse diagnostics
登录后即可评分或收藏
一个开源项目——浏览代码并从 GitHub 自托管。