Public leaderboard RMSLE
V31 ensemble ile yapılan final gönderim
Projeler yükleniyor
Yarışma vakası · Panel zaman serisi tahmini
İzmir ve Manisa’daki 7.036 dağıtım trafosunun günlük tüketimini dört ay ileriye tahmin eden, otuz bir turluk bir yarışma çalışması. Public leaderboard sonucu 1.02974 RMSLE ve 77. sıra.

V31 ensemble ile yapılan final gönderim
Gönderim anındaki public leaderboard sırası
1.226.237 eğitim ve 714.688 test satırı
7.036 test serisinin 2.024’ü eğitimde hiç yok
Asıl mesele daha büyük bir model değil, hangi denemenin kabul edileceğine karar veren kuraldı: her sürüm ancak eldeki çapayı geçtiğini bootstrap ve segment kontrolleriyle gösterdiğinde gönderildi.
01 / YÖNTEM
5.344 seri kadansına göre sınıflandırıldı: 4.125 günlük, 668 çoğunlukla günlük, 539 yetersiz geçmiş, 10 düzensiz. 92 seri kadans değiştiriyor ve 298 seri baştan sona sıfır; bunların 234’ü test döneminde de var.
Özellikler aileler hâlinde kuruldu ve kapsama oranlarıyla birlikte izlendi: identity 9, calendar 24, history 45, seasonal 14, zero_positive 30, peer_hierarchy 62, schedule 4, weather 50, static_spatial 11. Geçmişe dayalı aileler doğal olarak eksik kalıyor; kapsama, hangi ailenin cold-start satırlarda işe yaramayacağını önceden söylüyor.
Her yeni sürüm, eldeki çapaya karşı iki ayrı dönemde (seçim ve denetim) ölçüldü. Kabul için bootstrap dağılımının ve segment bazlı hasarın birlikte olumlu olması gerekiyordu; sıcak, seyrek ve soğuk segmentlerden herhangi biri bozulursa aday reddediliyordu.
V11’de dört dış aile eklendi: api_agri_weather 24, api_market_macro 14, regional_consumption_mix 5, domain_proxy 16. Kazanç kabul kapısını geçmedi ve V12 dokuz aileli omurgaya geri döndü. Ayrıca 233 özelliklik tam set, 123 özelliklik yalın sete karşı ölçüldü: yalın set 1.0982, tam set 1.0996 CV verdi.
Ağaç tabanlı çapa doyduktan sonra iki bağımsız nöral düzeltme denendi: V29 kimlik gömmeleriyle, V30 latent Fourier bileşenli DeepFM ile. İkisi de tek başına değil, V28 çapasına göre fark üreten birer düzeltme olarak tutuldu.
Final gönderim log uzayında V31 = V28 + 0,40 × (V29 − V28) + 0,60 × (V30 − V28) olarak hesaplanıyor. Düzeltmeler [−2, 2] aralığında kırpılıp expm1 ile tüketim ölçeğine dönüyor; ağırlıklar sabit, veriye göre yeniden ayarlanmıyor.
02 / BULGULAR
Gözlenen satırlardaki sıfır oranı 2025 Haziran’ında yaklaşık %7,3’ten %2,2’ye indi, sonra 2026 Mart’ına kadar kademeli olarak %4,7 civarına döndü. Bu bir mevsimsellik değil; ölçüm ya da kayıt davranışındaki bir değişim. Tek bir doğrulama penceresi seçmek, hangi tarafta durduğunuza göre farklı bir model seçtirir.
5.012 seri her iki dönemde de var, 332 seri yalnız eğitimde, 2.024 seri yalnız testte. Geçmişe dayalı özellikler bu satırlarda tanımsız kaldığı için skorun büyük kısmı, geçmişi olmayan trafolarda ne yapıldığıyla belirleniyor. peer_hierarchy ailesinin test kapsamının (%92,3) eğitim kapsamından (%73,5) yüksek olması tam olarak bu yüzden.
123 özelliklik yalın set genelde 1.0982, 233 özelliklik tam set 1.0996 CV verdi. Fark küçük ama yön nettir. Aynı ölçümde soğuk segment tersini söylüyor: yalın sette 2.9667, tam sette 2.8316. Yani özellik kısmak toplamda iyi, geçmişi olmayan seriler için kötü.
V13 hibrit uzman denemesi leaderboard’da 1.04977’den 1.09655’e geriledi. Kabul kuralı olmasaydı bu sürüm “yeni en iyi” diye taşınabilirdi; kural sayesinde V12 çapası korundu ve turnuva oradan devam etti. Skor grafiğinde V13’ün çizgi üzerinde değil, çizginin dışında durmasının sebebi budur.
03 / KARŞILAŞTIRMA
| Sürüm | Public RMSLE | Karar |
|---|---|---|
| V6 | 1.09742 | İlk çapa |
| V10 | 1.06016 | Temiz sayfa özellik omurgası |
| V12 | 1.04977 | Çok tohumlu sağlamlık |
| V13 | 1.09655 | Reddedildi — çapa korundu |
| V15 | 1.04292 | Yalın yapısal set |
| V20 | 1.04083 | Daha güvenli karışım oranı |
| V24 | 1.03522 | Kimlik hiyerarşisi karışımı |
| V27 | 1.03404 | Güvenlik ölçekli meta yönlendirici |
| V28 | 1.03340 | Global merkezleme |
| V31 | 1.02974 | Final ensemble — 77. sıra |
04 / GÖRSEL ANALİZ







05 / KAPSAM
GridUp’ın öğrettiği şey model seçimi değil, kabul kuralıydı. Otuz bir turun sonunda skoru 1.09742’den 1.02974’e taşıyan, tek bir parlak fikir değil; geri giden bir denemeyi (V13) taşımayı reddeden ve dış veri kazancı kanıtlanmadığında onu geri alan bir disiplin.
Kaynak kodu inceleSonraki proje