Skip to lesson

મશીન દ્વારા અનુવાદિત. અંગ્રેજી અને હિન્દી સમીક્ષિત સંસ્કરણો છે.Englishहिन्दी

  1. Learn
  2. See
  3. Try
  4. Make

RL પર્યાવરણ શું છે

What this lesson is about

RL એટલે ઇનામના સંકેતથી શીખવું. જુઓ કે કેવી રીતે કોઈ કાર્ય એ રીતે બને છે કે મોડેલ પોતે જ તે પર અભ્યાસ કરી શકે, અને કઈ કામગીરી અનુકૂળ નથી.

એક ટીમ એક મોડેલને ત્રણ કામ પોતે શીખવા માંગે છે: તારીખને ઉલટાવવી, સહાનુભૂતિ નોટ લખવી, અભિવાદન પસંદ કરવું. તમે કયું પસંદ કરશો?

Why this matters

ટ્રેનિંગ પછી ફક્ત ત્યાં જ વધી શકે છે જ્યાં સફળતાનું મૂલ્યાંકન વ્યક્તિ વિના થઈ શકે.

Read the primary or official source: Towers et al., Gymnasium: A Standard Interface for Reinforcement Learning Environments (arXiv)