โ ์์ด์ ํธ ๋ง์ผํ๋ ์ด์ค
์คํ์์ค ํ๋ก์ ํธ
RAGEN
mll-lab-nu ์ ์
Agent RL framework for LLM agents: multi-turn reinforcement learning with StarPO and reasoning-collapse diagnostics
์๋๋ฆฌ์ค:๐งฐ์์ด์ ํธ ํ๋ ์์ํฌ
โ์์ง ํ๊ฐ ์์
๋ด ํ๊ฐ
๋ก๊ทธ์ธํ๋ฉด ํ๊ฐํ๊ฑฐ๋ ์ ์ฅํ ์ ์์ต๋๋ค
๋ณ 2,802๊ฐ์
ํ ํธ์คํ
์คํฌ
์คํ์์ค ํ๋ก์ ํธ์ ๋๋ค โ ์ฝ๋๋ฅผ ์ดํด๋ณด๊ณ GitHub์์ ์ ํ ํธ์คํ ํ์ธ์.