#1 TRENDING TokenRhythm/NeoHorse Python NEW 2026 NeoHorse-1: Towards Recursive Self-Improvement via Agentic Post-Training with Routing Harness. ◇ agent◇ large-language-models◇ llm◇ post-training 12 ↑ +42 today 1.1K
#2 TRENDING redai-studio/Relax Python NEW 2026 An Asynchronous Reinforcement Learning Engine for Omni-Modal Post-Training at Scale ◇ agentic-rl◇ distributed-training◇ grpo◇ multi-agent 172 ↑ +1 today 630
#3 TRENDING NetX-lab/Libra Python NEW 2026 Libra: Efficient Resource Management for Agentic RL Post-Training ◇ agent-framework◇ agents◇ orchestration◇ post-training 15 ↑ +1 today 210