NeMo RL
Scalable reinforcement learning for LLM post-training.
An open-source framework for scalable reinforcement-learning post-training of large language models.

Recent stories
0 linked stories
No linked stories yet.
Scalable reinforcement learning for LLM post-training.
An open-source framework for scalable reinforcement-learning post-training of large language models.
