Faz A — Seed'li Referans Koşular
Öğrenme Eğrileri
Eğrilerin düz görünmesi bir görselleştirme hatası değildir — MRO görevinde tüm konfigürasyonlar ilk turlarda aynı sabit-eylem politikasına yakınsır ve bozulma koşulları metrikleri değiştirmez. Ayrıntı için Faz B dürüstlük notuna bakınız.
Kaynak: experiments/results/faz_a_curves.json (seed'li koşu, 11 Haziran 2026).
Konfigürasyon Karşılaştırması
XAI — Grup-Shapley Modalite Katkıları
Karşıolgusal Örnek
Eğitilmiş Ajan Karar Örnekleri
Kaynak: experiments/results/sample_decisions.json — eğitilmiş FedProx ajanıyla seed'li inference örnekleri.
Faz B — Dayanıklılık ve Confusion-Matrix Analizi
Eğrilerin düz görünmesi bir görselleştirme hatası değildir — MRO görevinde tüm konfigürasyonlar ilk turlarda aynı sabit-eylem politikasına yakınsır ve bozulma koşulları metrikleri değiştirmez. Ayrıntı için Faz B dürüstlük notuna bakınız.
Kaynak: experiments/results/faz_b_robustness.json — FedProx; çubuk = doğruluk, çizgi = kritik recall; imleçte ort±std.
Confusion Matrix (FedProx)
Tempo-Duyarlı Ödül Denemesi
Yöntem: Dayanıklılık ve confusion-matrix sonuçları için eğitilmiş ajanlar yeniden eğitilmeden, yalnızca gözlemlere uygulanan seed'li bozulmalar altında yeniden değerlendirildi (üç değerlendirme seed'i). Tempo-duyarlı ödül denemesinde ise ayrı bir ajan 160 tur yeniden eğitilip statik-ödül ortamında değerlendirildi. Ham JSON'lar GitHub deposunda: cdsa-mro/experiments/results
Faz C — ε Taraması ve Entropi-Hedefli Keşif
Her konfigürasyon, 160 turluk ayrı bir FedProx yeniden eğitimidir (seed 42); değerler statik-ödül ortamındaki final değerlendirmedir. Revizyon-hazırlık malzemesi — tüm değerler koşu JSON'larından okunur.
Diferansiyel Mahremiyet — ε Taraması (FedProx+DP)
Kaynak: experiments/results/faz_c_dp_sweep.json — eğriler eğitim boyunca ort. ödül, tablo final değerler.
Entropi-Hedefli Keşif (FedProx)
Kaynak: experiments/results/faz_c_entropy.json — eğriler eğitim boyunca ort. ödül, tablo final değerler.
Faz D — Yem-Sinyal Testi ve Kapılı Keşif
Her iki deney 160 turluk ayrı FedProx yeniden eğitimidir (seed 42). Decoy testi gözleme eklenen 2 alakasız U(0,1) kanalın grup-Shapley atıfını ölçer; kapılı keşifte 0.05 entropi bonusu yalnız probe kritik-recall >= 0.90 iken aktiftir.
Yem-Sinyal (Decoy) Atıf Testi (FedProx)
Kaynak: experiments/results/faz_d_decoy.json — grup-Shapley payları eylem başına (decoy sütunu vurgulu); alt tablo final değerler.
Kapılı Keşif — Recall Tabanlı Entropi (FedProx)
Kaynak: experiments/results/faz_d_gated_entropy.json — çizgi probe kritik-recall, kesikli çizgi taban, gölgeli bölgeler kapının açık olduğu aralıklar.