# Jump-Start Reinforcement Learning

**URL:** <https://discuss.ray.io/t/jump-start-reinforcement-learning/15991>\
**Category:** RLlib\
**Created:** [October 12, 2024, 2:06am UTC](https://discuss.ray.io/t/jump-start-reinforcement-learning/15991 "2024-10-12T02:06:19Z")\
**Posts on this page:** 1\
**Showing post:** 18

<div class="post-metadata">

**Author:** ![Samuel\_Fipps](https://sea2.discourse-cdn.com/flex020/user_avatar/discuss.ray.io/samuel_fipps/32/6632_2.png) [@Samuel\_Fipps](https://discuss.ray.io/u/Samuel_Fipps)\
**Post date:** [January 7, 2025, 2:49pm UTC](https://discuss.ray.io/t/jump-start-reinforcement-learning/15991/18 "2025-01-07T14:49:04Z")

</div>

Can I just use the 2 options that are talked about here?

[PPO nan in actor logits - #6 by tlaurie99](https://discuss.ray.io/t/ppo-nan-in-actor-logits/15140/6#:~:text=I%20would%20like%20to%20point%20to%20two%20options%20in%20RLlib%20that%20implement%20the%20suggestions%20given%20in%20this%20thread).

---

_[View the full topic](https://discuss.ray.io/t/jump-start-reinforcement-learning/15991)._
