Skip to lesson

ಯಂತ್ರ ಅನುವಾದಿತ. ಇಂಗ್ಲಿಷ್ ಮತ್ತು ಹಿಂದಿ ಪರಿಶೀಲಿತ ಆವೃತ್ತಿಗಳು.Englishहिन्दी

  1. Learn
  2. See
  3. Try
  4. Make

RL ಪರಿಸರವೆಂದರೆ ಏನು

What this lesson is about

RL ಅಂದರೆ ಬಹುಮಾನ ಸೂಚನೆಯಿಂದ ಕಲಿಯುವುದು. ಒಂದು ಕಾರ್ಯವು ಮಾದರಿಯು ಸ್ವತಃ ಅಭ್ಯಾಸ ಮಾಡಬಹುದಾದದ್ದು ಹೇಗೆ ಆಗುತ್ತದೆ ಮತ್ತು ಯಾವ ಕಾರ್ಯವು ಅಸಾಧ್ಯವಾಗುತ್ತದೆ ಎಂಬುದನ್ನು ನೋಡಿ.

ಒಂದು ತಂಡವು ಒಂದು ಮಾದರಿಯನ್ನು ಮೂರು ಕೆಲಸಗಳನ್ನು ಸ್ವತಃ ಕಲಿಯುವಂತೆ ಬಯಸುತ್ತದೆ: ದಿನಾಂಕಗಳನ್ನು ತಿರುಗಿಸುವುದು, ಸಹಾನುಭೂತಿ ನೋಟುಗಳನ್ನು ಬರೆಯುವುದು, ಶುಭಾಶಯವನ್ನು ಆಯ್ಕೆ ಮಾಡುವುದು. ನೀವು ಯಾವದನ್ನು ಆರಿಸುತ್ತೀರಿ?

Why this matters

ತರಬೇತಿ ನಂತರದ ಬೆಳವಣಿಗೆ ವ್ಯಕ್ತಿಯು ಪ್ರತಿಯೊಂದು ಪ್ರಯತ್ನವನ್ನು ಓದದೆ ಯಶಸ್ಸನ್ನು ಅಳೆಯಬಹುದಾದಲ್ಲಿ ಮಾತ್ರ ಸಾಧ್ಯ.

Read the primary or official source: Towers et al., Gymnasium: A Standard Interface for Reinforcement Learning Environments (arXiv)