Hangi yaklaşım daha çok cevap veriyor değil; hangisi yanlış durumda durabiliyor?
Aynı 100 sentetik vakayı iki karar yaklaşımına verdik. Etiketleri önce gizledik; sonra kaynak, risk ve insan onayı davranışlarını karşılaştırdık.
Yaklaşım A ve Yaklaşım B
Test sırasında yaklaşım isimleri sonuç tablosunda nötr tutuldu. Her ikisi aynı 100 vaka ve aynı beklenen karar etiketleriyle değerlendirildi.
Yaklaşım A
Her vakada otomatik devam eden temel yaklaşım. Kaynak, çelişki, risk veya dış aksiyon nedeniyle durmaz.
Yaklaşım B
Kaynak doğrulama, girdi kalitesi, risk seviyesi, dış aksiyon ve insan onayı kapılarını birlikte kullanan karar politikası.
Aynı 100 vaka. Farklı kontrol davranışı.
Bu test setinde 36 vaka otomatik ilerlemeli; 64 vaka ise inceleme, onay veya bloke etme yoluna gitmeliydi.
| Ölçü | Yaklaşım A | Yaklaşım B |
|---|---|---|
| Karar politikasıyla eşleşen vaka | 36/100 | 100/100 |
| Beklenen kontrol yolundan sapma | 64 | 0 |
| İnsan/güvenlik kapısı yakalama | 0/64 | 64/64 |
| Yanıltıcı veya kötü niyetli vakayı bloke etme | 0/15 | 15/15 |
| Otomatik devam | 100 | 36 |
| İnsan incelemesi | 0 | 29 |
| İnsan onayı | 0 | 20 |
| Bloke etme / üst seviyeye taşıma | 0 | 15 |
Fark, “daha akıllı model” değil; karar mimarisi.
Yaklaşım A bilinçli olarak basit tutulmuş bir temel yaklaşım: her vakada otomatik devam ediyor. Yaklaşım B ise yanıltıcı veya kötü niyetli girişte bloke ediyor; kaynak eksikse veya girdi çelişkiliyse insan incelemesine; yüksek etkili veya dış aksiyon içeren vakada insan onayına yönlendiriyor.
Karşılık: Yaklaşım B daha az vakayı otomatik ilerletiyor ve bu yüzden daha fazla insan kontrolü gerektiriyor. Bu karşılaştırmada gecikme süresi, maliyet ve insan düzenleme süresi ölçülmedi; bu alanlarda üstünlük iddiası yok.
Hata tek bir kutu değil.
Hatalar; girdi, kaynak/bağlam, karar mantığı, araç, format, politika ve insan süreci olarak ayrı sınıflandırılır; her biri farklı düzeltme mekanizması gerektirir.
Kaynak / bağlam
Kaynak eksik veya doğrulanamıyorsa kesinlik üretilmez.
Girdi
Eksik veya çelişkili girdi otomatik karar yerine inceleme yoluna gider.
Politika
Yetkisiz, yüksek etkili veya yanıltıcı aksiyonlar bloke/onay kapısına taşınır.
İnsan süreci
Onay yüzeyi kaynak, belirsizlik, reddetme ve üst seviyeye taşıma seçeneklerini göstermelidir.
Araç / format
Entegrasyon ve şema hataları ayrı test edilir; model cevabı ile karıştırılmaz.
Karar mantığı
Karar yolu, tanımlı politika ve kanıtla çelişiyorsa hata olarak sınıflanır.
“Daha iyi cevap” yerine daha güvenli davranış.
Kaynak yok
Önce: cevap üret ve devam et.
Sonra: kaynak iste veya insan incelemesine aktar.
Girdi çelişkili
Önce: değerlerden birini sessizce seç.
Sonra: çelişkiyi görünür yap ve kararı beklet.
Dış aksiyon
Önce: taslağı doğrudan gönder.
Sonra: taslağı hazırla; gönderimi insan onayında tut.
Bu sonuç neyi kanıtlamıyor?
Gerçek müşteri verisi kullanılmadı. Test seti sentetik ve beklenen davranış etiketleri önceden tanımlı. Sonuçlar bir yapay zekâ modelinin gerçek kullanım doğruluğunu, gerçek müşteri yatırım getirisini, hukuki/medikal/finansal doğruluğu veya mevzuat uyumunu kanıtlamaz. Maliyet, gecikme süresi ve insan düzenleme süresi bu çalışmada ölçülmedi.
Yeniden üretilebilir metodoloji ve sürüm notları GitHub'daki açık test paketinde bulunur.
Aynı kontrol sorularını kendi sürecinize uygulayın.
Ücretsiz araç temel süreç haritasını e-posta zorunluluğu olmadan çıkarır.
