Pekiştirmeli Öğrenme: Ajanın Strateji Ustası Bilgi Yarışması

Oluşturan: BilgiYarisi.com

Geri Dön
12 Soru
0 Kez Oynandı
Pekiştirmeli Öğrenme: Ajanın Strateji Ustası Bilgi Yarışması: Pekiştirmeli öğrenme dünyasına derinlemesine bir dalış yapın. Bu zorlu yapay zeka bilgi yarışması ile ödül tabanlı sistemler konusundaki bilginizi test edin ve uzmanlığınızı kanıtlayın.
Bu yarışmayı değerlendir:
Henüz oy yok

Sorular

Soru 1
Pekiştirmeli öğrenmede 'Exploration vs. Exploitation' ikilemini dengelemek için kullanılan, epsilon değerinin zamanla azaltıldığı yöntem hangisidir?
A Bellman Optimization
B Monte Carlo Tree Search
C Epsilon-Greedy Strategy
D Policy Gradient Method
Soru 2
Markov Decision Process (MDP) yapısında, bir durumdan diğerine geçiş olasılığını tanımlayan fonksiyon aşağıdakilerden hangisidir?
A Transition Probability Function
B Reward Function
C Value Function
D Discount Factor
Soru 3
Q-Learning algoritmasında, güncel durum-eylem çiftinin değerini güncellemek için kullanılan temel denklem hangisidir?
A Value Iteration
B Kullback-Leibler Divergence
C Bellman Equation
D Policy Iteration
Soru 4
Derin Pekiştirmeli Öğrenmede (Deep RL) 'Experience Replay' mekanizmasının ana amacı nedir?
A Daha büyük bir action space yönetmek
B Ödül fonksiyonunu dinamik olarak güncellemek
C Hesaplama maliyetini düşürmek
D Veriler arasındaki korelasyonu azaltarak kararlılığı artırmak
Soru 5
Aşağıdakilerden hangisi 'Model-Free' bir pekiştirmeli öğrenme yaklaşımıdır?
A AlphaZero
B Value Iteration
C SARSA
D Dyna-Q

📋 Bu yarışmada toplam 12 soru bulunmaktadır.

Tüm soruları ve doğru yanıtları görmek için giriş yapın!

🚨 Hata Bildir