1. Pekiştirmeli öğrenmede 'Exploration vs. Exploitation' ikilemini dengelemek için kullanılan, epsilon değerinin zamanla azaltıldığı yöntem hangisidir?
A)Bellman Optimization
B)Monte Carlo Tree Search
C)Epsilon-Greedy Strategy
D)Policy Gradient Method
2. Markov Decision Process (MDP) yapısında, bir durumdan diğerine geçiş olasılığını tanımlayan fonksiyon aşağıdakilerden hangisidir?
A)Transition Probability Function
B)Reward Function
C)Value Function
D)Discount Factor
3. Q-Learning algoritmasında, güncel durum-eylem çiftinin değerini güncellemek için kullanılan temel denklem hangisidir?
A)Value Iteration
B)Kullback-Leibler Divergence
C)Bellman Equation
D)Policy Iteration
4. Derin Pekiştirmeli Öğrenmede (Deep RL) 'Experience Replay' mekanizmasının ana amacı nedir?
A)Daha büyük bir action space yönetmek
B)Ödül fonksiyonunu dinamik olarak güncellemek
C)Hesaplama maliyetini düşürmek
D)Veriler arasındaki korelasyonu azaltarak kararlılığı artırmak
5. Aşağıdakilerden hangisi 'Model-Free' bir pekiştirmeli öğrenme yaklaşımıdır?
A)AlphaZero
B)Value Iteration
C)SARSA
D)Dyna-Q
6. Pekiştirmeli öğrenmede, ajanın uzun vadeli toplam ödülünü maksimize etmek için kullandığı 'gamma' (indirim faktörü) değerinin 0'a yakın olması ne anlama gelir?
A)Ajanın sadece anlık ödüllere odaklanması (myopic)
B)Ajanın öğrenme hızının artması
C)Ajanın rastgele hareket etmesi
D)Ajanın uzun vadeli ödülleri çok önemsemesi
7. Policy Gradient yöntemlerinde, gradientin yönünü belirlemek için kullanılan temel matematiksel teorem hangisidir?
A)Bayes Theorem
B)Markov Property
C)Central Limit Theorem
D)Policy Gradient Theorem
8. Aşağıdakilerden hangisi 'Off-policy' bir öğrenme algoritmasıdır?
A)Actor-Critic
B)SARSA
C)Monte Carlo Control
D)Q-Learning
9. Pekiştirmeli öğrenmede, bir durumun (state) değerini tahmin etmek yerine, doğrudan eylem (action) olasılıklarını öğrenen yaklaşıma ne ad verilir?
A)Policy-based methods
B)Value-based methods
C)Dynamic Programming
D)Temporal Difference Learning
10. Double DQN kullanılmasının temel sebebi aşağıdakilerden hangisidir?
A)Keşif (exploration) oranını artırmak
B)Daha hızlı eğitim süresi sağlamak
C)Q-değerlerinin aşırı tahmin edilmesini (overestimation) önlemek
D)Daha az veriyle öğrenmeyi sağlamak
11. Actor-Critic mimarisinde 'Critic' bileşeninin temel görevi nedir?
A)Ödül fonksiyonunu tasarlamak
B)Seçilen eylemin değerini (value) tahmin etmek
C)Çevreyi simüle etmek
D)Eylemleri seçmek
12. Pekiştirmeli öğrenmede 'Credit Assignment Problem' (Kredi Atama Problemi) neyi ifade eder?
A)Hangi eylemin nihai ödüle katkı sağladığını belirleme zorluğu
B)Ajanın ne kadar ödül aldığını hesaplama sorunu
C)Donanım kaynaklarının verimli kullanılması
D)Veri setindeki gürültü miktarı
13. Transformer mimarisinde 'Scaled Dot-Product Attention' mekanizmasının temel amacı nedir?
A)Modelin parametre sayısını azaltmak için ağırlık matrislerini matris ayrıştırma yöntemiyle küçültmek.
B)Eğitim sırasında gradyan kaybolması (vanishing gradient) problemini tamamen ortadan kaldırmak.
C)Girdi dizisindeki her kelimenin diğer kelimelerle olan ilişkisini ağırlıklandırarak bağlamsal vektörler oluşturmak.
D)Veri setindeki gürültüyü temizleyerek modelin daha hızlı yakınsamasını sağlamak.
14. BERT (Bidirectional Encoder Representations from Transformers) modelini GPT'den ayıran en temel yapısal fark nedir?
A)GPT, maskelenmiş dil modelleme (MLM) görevini kullanırken BERT sadece auto-regressive yöntem kullanır.
B)BERT, Transformer mimarisini kullanmaz, bunun yerine derin CNN yapılarını tercih eder.
C)BERT sadece decoder katmanlarını kullanırken, GPT sadece encoder katmanlarını kullanır.
D)BERT çift yönlü (bidirectional) bağlamı işlemek için sadece encoder katmanlarını kullanır.
15. Transformer mimarisindeki 'Multi-Head Attention' mekanizmasında farklı 'head'lerin kullanılmasının temel sebebi nedir?
A)Modelin ezberleme (overfitting) yapmasını engellemek için dropout uygulamak.
B)Girdi dizisinin uzunluğunu sınırlamak ve bellek kullanımını optimize etmek.
C)Modelin farklı alt uzaylardaki (subspaces) bilgileri eş zamanlı olarak öğrenmesine olanak tanımak.
D)İşlem maliyetini düşürmek için hesaplamayı paralel işlem birimlerine dağıtmak.
16. GPT serisi modellerin eğitiminde kullanılan 'Auto-regressive' yaklaşım ne anlama gelir?
A)Modelin tüm cümleyi aynı anda görerek boşlukları doldurması.
B)Girdi dizisinin hem başından hem sonundan başlayarak iki taraflı işlenmesi.
C)Eğitim verisinin etiketlenmesine gerek duymadan kendi kendini denetlemesi.
D)Modelin bir sonraki kelimeyi, kendinden önceki kelimelere dayanarak tahmin etmesi.
17. Transformer mimarisinde kullanılan 'Positional Encoding'in işlevi nedir?
C)Modeldeki gereksiz nöronların bağlantısını keserek seyrek (sparse) bir yapı oluşturur.
D)Derin ağlarda gradyanların daha kolay akmasını sağlayarak modelin eğitilebilirliğini artırır.
25. Bir makine öğrenmesi modelinde 'Algorithmic Bias' oluşmasının en temel teknik nedeni aşağıdakilerden hangisidir?
A)Eğitim verisindeki tarihsel eşitsizliklerin ve temsili bozuklukların modele aktarılması
B)Modelin aşırı yüksek öğrenme hızı (learning rate) ile eğitilmesi
C)Modelin sadece unsupervised learning yöntemleriyle eğitilmesi
D)GPU donanımının hesaplama kapasitesinin yetersiz kalması
26. Yapay zeka modellerinde 'Black Box' (Kara Kutu) problemini çözmek için kullanılan, modelin kararlarını anlamlandırılabilir kılmaya odaklanan alan hangisidir?
A)Explainable AI (XAI)
B)Reinforcement Learning
C)Transfer Learning
D)Federated Learning
27. Algoritmik adaleti sağlamak için kullanılan 'Individual Fairness' prensibi neyi ifade eder?
A)Modelin sadece azınlık gruplar üzerinde hata payını ölçmesi gerektiğini
B)Veri setindeki tüm değişkenlerin silinmesi gerektiğini
C)Algoritmanın tamamen rastgele seçim yapması gerektiğini
D)Benzer özelliklere sahip bireylerin benzer sonuçlar alması gerektiğini
28. Bir modelin eğitim verisi ile test verisi arasındaki performans farkının, modelin belirli bir grubu dışlamasından kaynaklandığı duruma ne ad verilir?
A)Underfitting
B)Representation Bias
C)Data Leakage
D)Overfitting
29. SHAP (SHapley Additive exPlanations) yöntemi makine öğrenmesinde hangi etik/teknik gereksinimi karşılar?
A)Modelin enerji verimliliğini artırmak
B)Modelin siber saldırılara karşı dayanıklılığını ölçmek
C)Modelin tahminlerine etki eden özelliklerin (features) katkısını açıklamak
D)Veri setini otomatik olarak temizlemek
30. LIME (Local Interpretable Model-agnostic Explanations) algoritmasının temel amacı nedir?
A)Verideki kişisel verileri anonimleştirmek
B)Modelin global doğruluğunu %100'e yaklaştırmak
C)Karmaşık bir modelin yerel kararlarını basit ve anlaşılır bir modelle açıklamak
D)Modeli daha hızlı eğitmek için veri setini küçültmek
31. YZ etiğinde 'Fairness through Unawareness' yaklaşımının en büyük eleştirisi nedir?
A)Yöntemin sadece derin öğrenme modellerinde çalışması
B)Modelin eğitim süresinin çok uzaması
C)Yasal olarak uygulanabilir olmaması
D)Hassas değişkenlerin (ırk, cinsiyet vb.) çıkarılsa bile proxy değişkenler üzerinden önyargının devam etmesi
32. Differential Privacy (Diferansiyel Gizlilik) tekniği YZ sistemlerinde hangi etik sorunu çözmeyi hedefler?
A)Modelin şeffaflık eksikliği
B)Eğitim verisinden bireysel verilerin ifşa edilmesi riski