CENG 567
Pekiştirmeli Öğrenme
Bu ders, çok kollu banditler, Q-öğrenme ve derin pekiştirmeli öğrenme gibi temel teknikleri kapsayacak şekilde pekiştirmeli öğrenmeyi tanıtır. Öğrenciler belirsizlik altında karar vermeyi öğrenecek ve aktör-kritik modeller gibi ileri düzey yöntemleri gerçek dünya problemlerine uygulayacaktır.
Dersin Amacı
Bu ders, çok kollu banditler, Q-öğrenme ve derin pekiştirmeli öğrenme gibi temel teknikleri kapsayacak şekilde pekiştirmeli öğrenmeyi tanıtır. Öğrenciler belirsizlik altında karar vermeyi öğrenecek ve aktör-kritik modeller gibi ileri düzey yöntemleri gerçek dünya problemlerine uygulayacaktır.
Dersin İçeriği
Çok kollu banditler, epsilon greedy, üst güven sınırları, thompson örneklemesi, bağlamsal banditler, markov karar süreci, dinamik programlama, politika ve değer iterasyonu, monte carlo yöntemleri, zamansal fark, Q-öğrenme, derin Q-öğrenme, aktör-kritik modeller.
Dersin Koordinatörü
Dr. Öğretim Üyesi Alper Demir
Dersi Verenler
Dr. Öğretim Üyesi Alper Demir
Önerilen veya Gerekli Kaynaklar
Richard S. Sutton, Andrew G. Barto. Reinforcement Learning: An Introduction. Bradford Books, 2nd ed., 2018.
Dersin Öğrenme Çıktıları
- Pekiştirmeli öğrenmenin temellerini ve temel kavramlarını anlayabilme.
- Q-öğrenme ve derin Q-öğrenme gibi temel algoritmaları uygulayabilme.
- Markov karar süreçlerini ve politika optimizasyonunu analiz edebilme.
- Pekiştirmeli öğrenme çözümlerini gerçek dünya senaryolarında uygulayabilme.
Haftalık Program
| Hafta | Konu |
| 1 | Giriş (İlgili Okuma: Sutton & Barto Bölüm 1) |
| 2 | Çok Kollu Banditler (İlgili Okuma: Sutton & Barto Bölüm 2) |
| 3 | Markov Karar Süreçleri (İlgili Okuma: Sutton & Barto Bölüm 3) |
| 4 | Dinamik Programlama (İlgili Okuma: Sutton & Barto Bölüm 4) |
| 5 | Monte Carlo Yöntemleri (İlgili Okuma: Sutton & Barto Bölüm 5) |
| 6 | Zamansal Fark Öğrenmesi (İlgili Okuma: Sutton & Barto Bölüm 6) |
| 7 | n-Adımlı Önyükleme (İlgili Okuma: Sutton & Barto Bölüm 7) |
| 8 | Tablosal Yöntemlerle Planlama ve Öğrenme (İlgili Okuma: Sutton & Barto Bölüm 8) |
| 9 | Değer Fonksiyonu Yaklaşımı ve Uygunluk İzleri (İlgili Okuma: Sutton & Barto Bölüm 9, 12) |
| 10 | Politika Gradyanı Yöntemleri ve Aktör-Kritik (İlgili Okuma: Sutton & Barto Bölüm 13 + Makaleler) |
| 11 | Derin Pekiştirmeli Öğrenme Yöntemleri (İlgili Okuma: Seçilmiş Makaleler) |
| 12 | İleri Düzey Konular (İlgili Okuma: Seçilmiş Makaleler) |
| 13 | İleri Düzey Konular (İlgili Okuma: Seçilmiş Makaleler) |
| 14 | Makale Sunumları |
Değerlendirme
3 Ödev: %24
Ara Sınav: %25
Final: %35
Makale Sunumu: %16
Öğretim Elemanı
- CENG 501
- CENG 502
- CENG 503
- CENG 504
- CENG 505
- CENG 506
- CENG 507
- CENG 508
- CENG 509
- CENG 511
- CENG 512
- CENG 513
- CENG 514
- CENG 515
- CENG 516
- CENG 517
- CENG 518
- CENG 521
- CENG 522
- CENG 523
- CENG 524
- CENG 525
- CENG 526
- CENG 531
- CENG 532
- CENG 533
- CENG 534
- CENG 541
- CENG 542
- CENG 543
- CENG 544
- CENG 551
- CENG 552
- CENG 555
- CENG 556
- CENG 557
- CENG 561
- CENG 562
- CENG 563
- CENG 564
- CENG 565
- CENG 566
- CENG 568
- CENG 600
- CENG 608
- CENG 611
- CENG 612
- CENG 613
- CENG 631
- CENG 632
- CENG 641
- CENG 642
- CENG 643
- CENG 651
- CENG 661
- CENG 662
- CENG 663
- CENG 690

