יסודות הבינה מלאכותית 13- RB34: המשך reinforcement learning – PPO

יסודות הבינה מלאכותית 13- RB34: המשך reinforcement learning – PPO