CDSA-ATM

Hava Trafik Yönetimi Sütunu — MA-FedPPO Akış Optimizasyonu

Precomputed seeded CPU-scale runs (Faz A, June 2026) İnteraktif simülasyon — operasyonel değil

Öğrenme Eğrileri

Kaynak: experiments/results/faz_a_curves.json (seed'li koşu, 11 Haziran 2026).

Konfigürasyon Karşılaştırması

Eğitilmiş Ajan Karar Örnekleri

Aksiyon dağılımı
Durum vektörü

Kaynak: experiments/results/sample_decisions.json — eğitilmiş FedProx ajanıyla seed'li inference örnekleri.

Faz B — Dayanıklılık ve Confusion-Matrix Analizi

Dürüstlük notu: Politika 5 eylemden yalnızca 2'sini kullanıyor ve tüm benign durumlar kritik tahmin alıyor — yüksek kritik recall bir “aşırı-uyarı rejimi” içinde elde ediliyor.

Kaynak: experiments/results/faz_b_robustness.json — FedProx; çubuk = doğruluk, çizgi = kritik recall; imleçte ort±std.

Confusion Matrix (FedProx)

Satır = gerçek sınıf, sütun = tahmin; hücreler ham sayımlar (renk satır-normalize). Kaynak: faz_b_confusion.json.

Tempo-Duyarlı Ödül Denemesi

Sonuç: tempo-duyarlı ödül, statik-ödül taban çizgisine göre iyileşme sağlamadı.

Yöntem: Dayanıklılık ve confusion-matrix sonuçları için eğitilmiş ajanlar yeniden eğitilmeden, yalnızca gözlemlere uygulanan seed'li bozulmalar altında yeniden değerlendirildi (üç değerlendirme seed'i). Tempo-duyarlı ödül denemesinde ise ayrı bir ajan 160 tur yeniden eğitilip statik-ödül ortamında değerlendirildi. Ham JSON'lar GitHub deposunda: cdsa-atm/experiments/results