Öğrenme Eğrileri
Kaynak: experiments/results/faz_a_curves.json (seed'li koşu, 11 Haziran 2026).
Konfigürasyon Karşılaştırması
XAI — Grup-Shapley Modalite Katkıları
Karşıolgusal Örnek
Eğitilmiş Ajan Karar Örnekleri
Aksiyon dağılımı
Durum vektörü
Kaynak: experiments/results/sample_decisions.json — eğitilmiş FedProx ajanıyla seed'li inference örnekleri.
Faz B — Dayanıklılık ve Confusion-Matrix Analizi
Dürüstlük notu: Politika 5 eylemden yalnızca 2'sini kullanıyor ve tüm benign durumlar kritik tahmin alıyor — yüksek kritik recall bir “aşırı-uyarı rejimi” içinde elde ediliyor.
Kaynak: experiments/results/faz_b_robustness.json — FedProx; çubuk = doğruluk, çizgi = kritik recall; imleçte ort±std.
Confusion Matrix (FedProx)
Satır = gerçek sınıf, sütun = tahmin; hücreler ham sayımlar (renk satır-normalize). Kaynak: faz_b_confusion.json.
Tempo-Duyarlı Ödül Denemesi
Sonuç: tempo-duyarlı ödül, statik-ödül taban çizgisine göre iyileşme sağlamadı.
Yöntem: Dayanıklılık ve confusion-matrix sonuçları için eğitilmiş ajanlar yeniden eğitilmeden, yalnızca gözlemlere uygulanan seed'li bozulmalar altında yeniden değerlendirildi (üç değerlendirme seed'i). Tempo-duyarlı ödül denemesinde ise ayrı bir ajan 160 tur yeniden eğitilip statik-ödül ortamında değerlendirildi. Ham JSON'lar GitHub deposunda: cdsa-atm/experiments/results