İçeriğe atla

ÖLÇÜMLER

14 sistem, aynı Türkçe test setinde ve aynı yöntemle değerlendirildi.

Ölçülen en yüksek yakalama oranı Siper'de: %84,6; en yakın alternatif %72,4. Siper ve 13 alternatif, etiketleri insan tarafından doğrulanmış 403 belgelik Türkçe test setinde, ortak etiket şeması ve aynı puanlama yöntemiyle değerlendirildi; sonuçlar %95 güven aralıklarıyla birlikte aşağıda. Ticari ürünler, değerlendirme tarihindeki resmi API'leri ve gerçek erişim anahtarlarıyla çalıştırıldı.

Temmuz 2026 değerlendirmesi · 403 belge

Sonuçlara geçin

%84,6

Yakalama oranı (recall)

Kişisel veri alanlarında; en yakın alternatif %72,4

0,672

Genel F1 skoru

Micro-F1 · %95 GA 0,647-0,695

13

Karşılaştırılan alternatif

Siper dahil 14 sistem, aynı yöntemle değerlendirildi

304 ms

Medyan yanıt süresi

Yönetilen hizmet · İstanbul

Karşılaştırma nasıl adil tutuldu?

Siper ve 13 alternatif, etiketleri insan tarafından doğrulanmış aynı Türkçe test setinde değerlendirildi. Sonuçların tamamı, karşılaştırılan ürünlerden bağımsız çalışan aynı puanlama yazılımıyla hesaplandı; ücretli araçlar gerçek API anahtarlarıyla çalıştırıldı.

İki sistem arasındaki fark ne zaman anlamlı sayılır?

Her skor %95 güven aralığıyla verilir. Sistemler arasındaki farklar, belge düzeyinde eşleştirilmiş yeniden örneklemeyle değerlendirilir. Skor farkının %95 güven aralığı sıfırı içeriyorsa üstünlük iddia edilmez.

KVKK m.6 kategorileri neden ayrı raporlanıyor?

Sağlık, din, siyasi görüş, sendika üyeliği ve ceza mahkûmiyeti gibi özel nitelikli kategoriler ayrı ayrı raporlanır; kritik alanlardaki performans toplam skorun içinde kaybolmaz.

Şekil A

Doğruluk ve gecikme haritası

Recall (özel nitelikli ana set) x uçtan uca medyan gecikme

Sol üst bölge, yüksek doğruluk ile düşük gecikmenin birlikte sağlandığı sistemleri gösterir. Dolu işaretler kurum içinde çalıştırılabilen sistemlerdir.

  1. Gurubase Siper

    Kurum içinde çalışabilir

    Recall
    0,846
    Medyan
    304 ms
  2. Bulut LLM A

    Bulut API

    Recall
    0,724
    Medyan
    18,1 sn
  3. Bulut LLM B

    Bulut API

    Recall
    0,546
    Medyan
    1,8 sn
  4. Açık model LLM

    Kurum içinde çalışabilir

    Recall
    0,513
    Medyan
    19,2 sn
  5. Küresel PII API'si A

    Bulut API

    Recall
    0,483
    Medyan
    561 ms
  6. Açık kaynak araç A (iyi yapılandırma)

    Kurum içinde çalışabilir

    Recall
    0,479
    Medyan
    148 ms
  7. Açık kaynak araç D

    Kurum içinde çalışabilir

    Recall
    0,318
    Medyan
    67 ms
  8. Küresel bulut sağlayıcı B

    Bulut API

    Recall
    0,298
    Medyan
    220 ms
  9. Açık kaynak araç A (hazır profil)

    Kurum içinde çalışabilir

    Recall
    0,263
    Medyan
    173 ms
  10. Küresel bulut sağlayıcı A

    Bulut API

    Recall
    0,247
    Medyan
    221 ms
  11. Küresel PII API'si B

    Bulut API

    Recall
    0,215
    Medyan
    491 ms
  12. Açık kaynak araç C

    Kurum içinde çalışabilir

    Recall
    0,195
    Medyan
    7 ms
  13. Açık kaynak araç B

    Kurum içinde çalışabilir

    Recall
    0,190
    Medyan
    281 ms
  14. Açık ağırlık filtre

    Kurum içinde çalışabilir

    Recall
    0,093
    Medyan
    3,7 sn
Tam grafiği inceleyin
0,000,250,500,7510 ms100 ms1 sn10 snmedyan gecikme (log)RecallGurubase SiperBulut LLM ABulut LLM BAçık model LLMKüresel PII API'si AAçık kaynak araç A (iyi yapılandırma)Açık kaynak araç DKüresel bulut sağlayıcı AKüresel bulut sağlayıcı BAçık kaynak araç BAçık kaynak araç A (hazır profil)Küresel PII API'si BAçık ağırlık filtreAçık kaynak araç C

Kaynak: Gurubase ölçümleri, Temmuz 2026. Gecikme ekseni logaritmiktir; 14 sistemin tamamı haritadadır.

Ölçüm ne söylüyor?

  • Siper %84,6 yakalama oranını 304 ms medyan yanıtla veriyor. Doğrulukta en yakın alternatifin medyan yanıtı 18 saniyenin üzerinde.
  • Özel nitelikli yedi kategorinin yedisinde de 0,65 üzeri yakalama ölçülen tek sistem Siper.
  • 117 eşleştirilmiş karşılaştırmanın 106 tanesinde fark Siper lehine anlamlı; hiçbir karşılaştırmada anlamlı bir rakip üstünlüğü ölçülmedi.

Şekil B

Yakalama oranı sıralaması ve %95 güven aralıkları

  1. Gurubase Siper

    Recall: 0,846
  2. Bulut LLM A

    Recall: 0,724
  3. Bulut LLM B

    Recall: 0,546
  4. Açık model LLM

    Recall: 0,513
  5. Küresel PII API'si A

    Recall: 0,483
  6. Açık kaynak araç A (iyi yapılandırma)

    Recall: 0,479
  7. Açık kaynak araç D

    Recall: 0,318
  8. Küresel bulut sağlayıcı B

    Recall: 0,298
  9. Açık kaynak araç A (hazır profil)

    Recall: 0,263
  10. Küresel bulut sağlayıcı A

    Recall: 0,247
  11. Küresel PII API'si B

    Recall: 0,215
  12. Açık kaynak araç C

    Recall: 0,195
  13. Açık kaynak araç B

    Recall: 0,190
  14. Açık ağırlık filtre

    Recall: 0,093
Tam grafiği inceleyin
  1. Gurubase Siper

    Recall: 0,846

    %95 GA 0,824–0,868

  2. Bulut LLM A

    Recall: 0,724

    %95 GA 0,693–0,755

  3. Bulut LLM B

    Recall: 0,546

    %95 GA 0,499–0,591

  4. Açık model LLM

    Recall: 0,513

    %95 GA 0,478–0,547

  5. Küresel PII API'si A

    Recall: 0,483

    %95 GA 0,442–0,521

  6. Açık kaynak araç A (iyi yapılandırma)

    Recall: 0,479

    %95 GA 0,442–0,520

  7. Açık kaynak araç D

    Recall: 0,318

    %95 GA 0,278–0,358

  8. Küresel bulut sağlayıcı B

    Recall: 0,298

    %95 GA 0,256–0,340

  9. Açık kaynak araç A (hazır profil)

    Recall: 0,263

    %95 GA 0,223–0,306

  10. Küresel bulut sağlayıcı A

    Recall: 0,247

    %95 GA 0,203–0,290

  11. Küresel PII API'si B

    Recall: 0,215

    %95 GA 0,173–0,259

  12. Açık kaynak araç C

    Recall: 0,195

    %95 GA 0,158–0,232

  13. Açık kaynak araç B

    Recall: 0,190

    %95 GA 0,151–0,231

  14. Açık ağırlık filtre

    Recall: 0,093

    %95 GA 0,061–0,130

Kaynak: Gurubase ölçümleri, Temmuz 2026; 403 belge, 1.000 yeniden örneklemeli belge güven aralığı. Güven aralığı çizgisi recall ve F1 görünümlerinde gösterilir.

Tablo 01

Ölçülen doğruluk

403 belgelik ana sette varlık düzeyinde ölçüm; Temmuz 2026 değerlendirmesi.

14 sistem

Yüksek değer daha iyi

  1. Gurubase Siper

    Kurum içiYanlış alarm: 0,057

    Recall

    0,846

    Tüm ölçümler
    Recall
    0,846
    Precision
    0,558
    F1 (%95 GA)
    0,672 [0,647-0,695]
    Yanlış alarm
    0,057
  2. Bulut LLM A

    Bulut APIYanlış alarm: 0,138

    Recall

    0,724

    Tüm ölçümler
    Recall
    0,724
    Precision
    0,528
    F1 (%95 GA)
    0,611 [0,583-0,638]
    Yanlış alarm
    0,138
  3. Bulut LLM B

    Bulut APIYanlış alarm: 0,023

    Recall

    0,546

    Tüm ölçümler
    Recall
    0,546
    Precision
    0,517
    F1 (%95 GA)
    0,531 [0,495-0,564]
    Yanlış alarm
    0,023
  4. Açık model LLM

    Kurum içiYanlış alarm: 0,077

    Recall

    0,513

    Tüm ölçümler
    Recall
    0,513
    Precision
    0,500
    F1 (%95 GA)
    0,506 [0,474-0,537]
    Yanlış alarm
    0,077
  5. Küresel PII API'si A

    Bulut APIYanlış alarm: 0,501

    Recall

    0,483

    Tüm ölçümler
    Recall
    0,483
    Precision
    0,492
    F1 (%95 GA)
    0,487 [0,453-0,519]
    Yanlış alarm
    0,501
  6. Açık kaynak araç A (iyi yapılandırma)

    Kurum içiYanlış alarm: 0,820

    Recall

    0,479

    Tüm ölçümler
    Recall
    0,479
    Precision
    0,362
    F1 (%95 GA)
    0,412 [0,381-0,445]
    Yanlış alarm
    0,820
  7. Açık kaynak araç D

    Kurum içiYanlış alarm: 0,026

    Recall

    0,318

    Tüm ölçümler
    Recall
    0,318
    Precision
    0,581
    F1 (%95 GA)
    0,411 [0,367-0,452]
    Yanlış alarm
    0,026
  8. Küresel bulut sağlayıcı B

    Bulut APIYanlış alarm: 0,421

    Recall

    0,298

    Tüm ölçümler
    Recall
    0,298
    Precision
    0,416
    F1 (%95 GA)
    0,347 [0,308-0,387]
    Yanlış alarm
    0,421
  9. Açık kaynak araç A (hazır profil)

    Kurum içiYanlış alarm: 0,865

    Recall

    0,263

    Tüm ölçümler
    Recall
    0,263
    Precision
    0,206
    F1 (%95 GA)
    0,231 [0,198-0,263]
    Yanlış alarm
    0,865
  10. Küresel bulut sağlayıcı A

    Bulut APIYanlış alarm: 0,043

    Recall

    0,247

    Tüm ölçümler
    Recall
    0,247
    Precision
    0,681
    F1 (%95 GA)
    0,362 [0,308-0,414]
    Yanlış alarm
    0,043
  11. Küresel PII API'si B

    Bulut APIYanlış alarm: 0,943

    Recall

    0,215

    Tüm ölçümler
    Recall
    0,215
    Precision
    0,187
    F1 (%95 GA)
    0,200 [0,165-0,235]
    Yanlış alarm
    0,943
  12. Açık kaynak araç C

    Kurum içiYanlış alarm: 0,983

    Recall

    0,195

    Tüm ölçümler
    Recall
    0,195
    Precision
    0,073
    F1 (%95 GA)
    0,106 [0,085-0,129]
    Yanlış alarm
    0,983
  13. Açık kaynak araç B

    Kurum içiYanlış alarm: 0,407

    Recall

    0,190

    Tüm ölçümler
    Recall
    0,190
    Precision
    0,390
    F1 (%95 GA)
    0,255 [0,208-0,306]
    Yanlış alarm
    0,407
  14. Açık ağırlık filtre

    Kurum içiYanlış alarm: 0,198

    Recall

    0,093

    Tüm ölçümler
    Recall
    0,093
    Precision
    0,412
    F1 (%95 GA)
    0,152 [0,102-0,204]
    Yanlış alarm
    0,198

Yanlış alarm: kişisel veri içermeyen 349 gerçek belgede en az bir gereksiz maske üretilen belge oranı. Yanlış alarm oranı, yakalama oranıyla (recall) birlikte değerlendirilmelidir. Çok az tespit üreten bir sistemin yanlış alarmı düşük görünebilir; ancak gerçek kişisel verilerin önemli bölümünü kaçırıyor olabilir.

Not: Küresel bulut sağlayıcı C, kendi resmi dokümantasyonuna göre Türkçe PII tespiti desteklememektedir.

Yapılan 117 eşleştirilmiş karşılaştırmanın (13 alternatif x 9 ortak sınıf: kişi adı, adres ve yedi m.6 kategorisi) 106 tanesinde istatistiksel olarak anlamlı fark Siper lehineydi. Kalan 11 karşılaştırmada anlamlı fark gözlenmedi; hiçbir karşılaştırmada anlamlı bir rakip üstünlüğü ölçülmedi.

Şekil C

KVKK m.6 kategorilerinde yakalama oranı (recall)

Koyu renkler daha yüksek kategori performansını gösterir. KD işaretli hücreler kapsam dışıdır: sistemin etiket şemasında bu kategori yoktur. KD hücreler, ölçülmüş 0,00 değerinden ayrı gösterilir.

  1. Gurubase Siper

    Sağlık: 0,78
  2. Bulut LLM A

    Sağlık: 0,69
  3. Küresel PII API'si A

    Sağlık: 0,52
  4. Açık model LLM

    Sağlık: 0,50
  5. Bulut LLM B

    Sağlık: 0,36
  6. Açık kaynak araç A (iyi yapılandırma)

    Sağlık: 0,21
  7. Açık kaynak araç D

    Sağlık: 0,17
  8. Küresel bulut sağlayıcı B

    Sağlık: 0,00
  9. Küresel PII API'si B

    Sağlık: 0,00
  10. Küresel bulut sağlayıcı A

    Sağlık: KD
  11. Açık kaynak araç B

    Sağlık: KD
  12. Açık kaynak araç A (hazır profil)

    Sağlık: KD
  13. Açık ağırlık filtre

    Sağlık: KD
  14. Açık kaynak araç C

    Sağlık: KD
Tam grafiği inceleyin
Yedi KVKK m.6 kategorisinde 14 sistemin recall değerleri
Gurubase Siper
0,780,860,930,680,910,790,81
Bulut LLM A
0,690,880,960,810,890,520,71
Bulut LLM B
0,360,780,680,390,770,140,52
Açık model LLM
0,500,300,790,470,850,170,56
Küresel PII API'si A
0,520,560,910,37KD0,000,04
Açık kaynak araç A (iyi yapılandırma)
0,210,420,850,530,470,210,17
Açık kaynak araç D
0,17KD0,41KDKDKDKD
Küresel bulut sağlayıcı A
KDKDKDKDKDKDKD
Küresel bulut sağlayıcı B
0,000,300,600,000,000,06KD
Açık kaynak araç B
KDKDKDKDKDKDKD
Açık kaynak araç A (hazır profil)
KDKDKDKDKDKDKD
Küresel PII API'si B
0,00KD0,09KDKDKDKD
Açık ağırlık filtre
KDKDKDKDKDKDKD
Açık kaynak araç C
KDKDKDKDKDKDKD

Kaynak: Gurubase ölçümleri, Temmuz 2026; kategori düzeyinde recall.

Tablo 02

KVKK m.6 özel nitelikli kategoriler

403 belgelik ana setin yedi özel nitelikli veri kategorisinde kategori bazlı yakalama oranı (recall); Temmuz 2026 değerlendirmesi.

Kategori bazlı yakalama oranı. Yüksek değer daha iyi.

  1. Gurubase Siper

    Sağlık: 0,78

    Tüm kategoriler
    Sağlık
    0,78
    Din
    0,86
    Etnik köken
    0,93
    Siyasi görüş
    0,68
    Sendika üyeliği
    0,91
    Ceza mahkûmiyeti
    0,79
    Cinsel hayat
    0,81
  2. Bulut LLM A

    Sağlık: 0,69

    Tüm kategoriler
    Sağlık
    0,69
    Din
    0,88
    Etnik köken
    0,96
    Siyasi görüş
    0,81
    Sendika üyeliği
    0,89
    Ceza mahkûmiyeti
    0,52
    Cinsel hayat
    0,71
  3. Küresel PII API'si A

    Sağlık: 0,52

    Tüm kategoriler
    Sağlık
    0,52
    Din
    0,56
    Etnik köken
    0,91
    Siyasi görüş
    0,37
    Sendika üyeliği
    KD
    Ceza mahkûmiyeti
    0,00
    Cinsel hayat
    0,04
  4. Açık model LLM

    Sağlık: 0,50

    Tüm kategoriler
    Sağlık
    0,50
    Din
    0,30
    Etnik köken
    0,79
    Siyasi görüş
    0,47
    Sendika üyeliği
    0,85
    Ceza mahkûmiyeti
    0,17
    Cinsel hayat
    0,56
  5. Bulut LLM B

    Sağlık: 0,36

    Tüm kategoriler
    Sağlık
    0,36
    Din
    0,78
    Etnik köken
    0,68
    Siyasi görüş
    0,39
    Sendika üyeliği
    0,77
    Ceza mahkûmiyeti
    0,14
    Cinsel hayat
    0,52
  6. Açık kaynak araç A (iyi yapılandırma)

    Sağlık: 0,21

    Tüm kategoriler
    Sağlık
    0,21
    Din
    0,42
    Etnik köken
    0,85
    Siyasi görüş
    0,53
    Sendika üyeliği
    0,47
    Ceza mahkûmiyeti
    0,21
    Cinsel hayat
    0,17
  7. Açık kaynak araç D

    Sağlık: 0,17

    Tüm kategoriler
    Sağlık
    0,17
    Din
    KD
    Etnik köken
    0,41
    Siyasi görüş
    KD
    Sendika üyeliği
    KD
    Ceza mahkûmiyeti
    KD
    Cinsel hayat
    KD
  8. Küresel bulut sağlayıcı B

    Sağlık: 0,00

    Tüm kategoriler
    Sağlık
    0,00
    Din
    0,30
    Etnik köken
    0,60
    Siyasi görüş
    0,00
    Sendika üyeliği
    0,00
    Ceza mahkûmiyeti
    0,06
    Cinsel hayat
    KD
  9. Küresel PII API'si B

    Sağlık: 0,00

    Tüm kategoriler
    Sağlık
    0,00
    Din
    KD
    Etnik köken
    0,09
    Siyasi görüş
    KD
    Sendika üyeliği
    KD
    Ceza mahkûmiyeti
    KD
    Cinsel hayat
    KD
  10. Küresel bulut sağlayıcı A

    Sağlık: KD

    Tüm kategoriler
    Sağlık
    KD
    Din
    KD
    Etnik köken
    KD
    Siyasi görüş
    KD
    Sendika üyeliği
    KD
    Ceza mahkûmiyeti
    KD
    Cinsel hayat
    KD
  11. Açık kaynak araç B

    Sağlık: KD

    Tüm kategoriler
    Sağlık
    KD
    Din
    KD
    Etnik köken
    KD
    Siyasi görüş
    KD
    Sendika üyeliği
    KD
    Ceza mahkûmiyeti
    KD
    Cinsel hayat
    KD
  12. Açık kaynak araç A (hazır profil)

    Sağlık: KD

    Tüm kategoriler
    Sağlık
    KD
    Din
    KD
    Etnik köken
    KD
    Siyasi görüş
    KD
    Sendika üyeliği
    KD
    Ceza mahkûmiyeti
    KD
    Cinsel hayat
    KD
  13. Açık ağırlık filtre

    Sağlık: KD

    Tüm kategoriler
    Sağlık
    KD
    Din
    KD
    Etnik köken
    KD
    Siyasi görüş
    KD
    Sendika üyeliği
    KD
    Ceza mahkûmiyeti
    KD
    Cinsel hayat
    KD
  14. Açık kaynak araç C

    Sağlık: KD

    Tüm kategoriler
    Sağlık
    KD
    Din
    KD
    Etnik köken
    KD
    Siyasi görüş
    KD
    Sendika üyeliği
    KD
    Ceza mahkûmiyeti
    KD
    Cinsel hayat
    KD

Hücre değerleri kategori bazlı recall'dur (0 ile 1 arası). KD: kapsam dışı; sistemin etiket şemasında bu kategoriye karşılık gelen bir tip yok. 0,00: kategori destekleniyor ancak bu sette doğru tespit üretilemedi.

m.6 kategorileri çoğu küresel aracın etiket şemasında yoktur; bu hücreler KD (kapsam dışı) olarak işaretlenir ve sayısal sıfırdan ayrı tutulur. 0,00 görünen hücreler, kategoriyi destekleyip bu sette doğru tespit üretemeyen sistemlerdir. Hücre bazlı gerekçeler, ürün adlarının açıklandığı ayrıntılı raporda yer alır.

Şekil D

Medyan gecikme

uçtan uca medyan yanıt süresi · logaritmik eksen

1.046 karakterlik sabit Türkçe metin; 3 ısınma sonrası ardışık istekler, bağlantı yeniden kullanımıyla.

  1. Açık kaynak araç C

    Medyan: 7 ms
  2. Açık kaynak araç D

    Medyan: 67 ms
  3. Açık kaynak araç A (iyi yapılandırma)

    Medyan: 148 ms
  4. Açık kaynak araç A (hazır profil)

    Medyan: 173 ms
  5. Küresel bulut sağlayıcı B

    Medyan: 220 ms
  6. Küresel bulut sağlayıcı A

    Medyan: 221 ms
  7. Açık kaynak araç B

    Medyan: 281 ms
  8. Gurubase Siper

    Medyan: 304 ms
  9. Küresel PII API'si B

    Medyan: 491 ms
  10. Küresel PII API'si A

    Medyan: 561 ms
  11. Bulut LLM B

    Medyan: 1,8 sn
  12. Açık ağırlık filtre

    Medyan: 3,7 sn
  13. Bulut LLM A

    Medyan: 18,1 sn
  14. Açık model LLM

    Medyan: 19,2 sn
Tam grafiği inceleyin
10 ms100 ms1 sn10 snGurubase Siper304 msBulut LLM A18,1 snBulut LLM B1,8 snAçık model LLM19,2 snKüresel PII API'si A561 msAçık kaynak araç A (iyi yapılandırma)148 msAçık kaynak araç D67 msKüresel bulut sağlayıcı A221 msKüresel bulut sağlayıcı B220 msAçık kaynak araç B281 msAçık kaynak araç A (hazır profil)173 msKüresel PII API'si B491 msAçık ağırlık filtre3,7 snAçık kaynak araç C7 ms

Kaynak: Gurubase ölçümleri, Temmuz 2026. Farklı sistemler farklı ortamlarda çalıştırıldı; tablo büyüklük sırası içindir.

Tablo 03

Ölçülen gecikme

1.046 karakterlik sabit Türkçe metinle ölçülen medyan ve p95 yanıt süresi.

Sistem ve çalıştırmaMedyanp95
  1. Gurubase Siper

    Bulut API · İstanbul

    Medyan: 304ms

    p95: 370ms

  2. Bulut LLM A

    Bulut API

    Medyan: 18.115ms

    p95: 19.621ms

  3. Bulut LLM B

    Bulut API

    Medyan: 1.790ms

    p95: 2.072ms

  4. Açık model LLM

    Yerel sunucu (GPU)

    Medyan: 19.242ms

    p95: 19.367ms

  5. Küresel PII API'si A

    Bulut API

    Medyan: 561ms

    p95: 629ms

  6. Açık kaynak araç A (iyi yapılandırma)

    Yerel sunucu (CPU)

    Medyan: 148ms

    p95: 161ms

  7. Açık kaynak araç D

    Yerel sunucu (CPU)

    Medyan: 67ms

    p95: 71ms

  8. Küresel bulut sağlayıcı A

    Bulut API

    Medyan: 221ms

    p95: 264ms

  9. Küresel bulut sağlayıcı B

    Bulut API

    Medyan: 220ms

    p95: 289ms

  10. Açık kaynak araç B

    Yerel sunucu (CPU)

    Medyan: 281ms

    p95: 316ms

  11. Açık kaynak araç A (hazır profil)

    Yerel sunucu (CPU)

    Medyan: 173ms

    p95: 201ms

  12. Küresel PII API'si B

    Bulut API

    Medyan: 491ms

    p95: 568ms

  13. Açık ağırlık filtre

    Yerel sunucu (CPU)

    Medyan: 3.731ms

    p95: 4.052ms

  14. Açık kaynak araç C

    Yerel sunucu (CPU)

    Medyan: 7ms

    p95: 8ms

Sistemler farklı altyapılarda çalıştırıldığı için sonuçlar bire bir donanım kıyaslaması değildir; tablo, yanıt sürelerinin büyüklük düzeylerini gösterir.

Tablo 04

Kurulum ve limitler

Üretim kurulumunda karar verirken bakılan operasyonel farklar.

Kurum içi kurulum; veri dışarı çıkmaz
Siper
Var
Alternatifler
Bulut API'lerde yok; açık kaynak araçlarda var
Türkçeye özel geliştirme
Siper
Var
Alternatifler
Genel çok dilli destek
Girdi limiti (karakter/istek)
Siper
50.000
Alternatifler
Ürüne göre değişiyor; karşılaştırılan bulut servislerinde gözlenen en düşük limit 5.120 karakter
OpenAI API'siyle uyumlu AI gateway dahili
Siper
Var
Alternatifler
Yok
İstanbul veri merkezinde yönetilen hizmet
Siper
Var
Alternatifler
Yok

Bu ölçüm nasıl yapıldı, nerede sınırlanıyor?

Protokol

  • Her sistem aynı sette, karşılaştırılan ürünlerden bağımsız çalışan aynı puanlama yazılımıyla değerlendirilir.
  • Kategori şemaları ortak taksonomiye eşlenir; bir sistemin hiç iddia etmediği kategori kapsam dışı sayılır, sıfır gibi gösterilmez.
  • Her değerlendirmenin tarihi ve sistem sürümü kaydedilir.
  • Skorlar yalnızca nokta tahmini olarak verilmez; örneklem belirsizliğini göstermek için %95 güven aralıklarıyla (1.000 belge yeniden örneklemesi) raporlanır.

Sınırlılıklar

  • Bu sayfa bağımsız denetim değildir; test seti bize aittir ve sonuçlar veri setine, yapılandırmaya göre değişebilir.
  • Gecikme ölçümleri farklı ortamlarda alınmıştır; büyüklük sırası karşılaştırması içindir.
  • Ticari ürünler, karşılaştırma yayın politikaları gereği anonim gösterilir; ölçüm ve eşleme kayıtları tarafımızda saklanır, talep hâlinde paylaşılır.

Ölçümler Temmuz 2026'da, insan doğrulamalı 403 belgelik Türkçe test setinde yapılmıştır. Sonuçlar bağımsız denetim değildir; veri seti ve yapılandırmaya göre değişebilir.

Ayrıntılı teknik rapor

Ürün adlarını, kategori eşleme kurallarını, sistem yapılandırmalarını ve yeniden çalıştırma notlarını içeren ayrıntılı rapor, gizlilik sözleşmesi kapsamında paylaşılır.

Ayrıntılı raporu isteyin

SSS

Sık sorulan sorular

Recall (yakalama oranı) nedir?

Recall, metindeki gerçek kişisel verilerin ne kadarının yakalandığını ölçer. Kaçan veri, yakalanandan daha pahalıya patlar; bu yüzden manşet metriğimiz recall. 403 belgelik sette %84,6 ölçtük.

F1 ve %95 güven aralığı ne anlatır?

F1, yakalama (recall) ile isabet (precision) dengesini tek sayıda birleştirir; Siper 0,672 ölçtü. Güven aralığı (0,647-0,695), ölçümü belge düzeyinde 1.000 kez yeniden örnekleyerek hesaplanır: tek bir ölçümün şansına değil, aralığa bakarız.

Yanlış alarm oranı neden önemli?

Yanlış alarm, temiz bir metinde olmayan kişisel veriyi var sanmaktır. Kişisel veri içermeyen 349 gerçek belgede en az bir gereksiz maske üretilen belge oranını ölçtük: Siper'de %5,7. Düşük yanlış alarm, düşük yakalamayla birlikte okunmalı; az maskeleyen sistem temiz metinde de az hata yapar.

Sonuçlar hangi veriyle ölçüldü?

Etiketleri insan tarafından doğrulanmış 403 belgelik Türkçe test setinde, Temmuz 2026'da. Siper dahil 14 sistem aynı sette ve karşılaştırılan ürünlerden bağımsız çalışan aynı puanlama yazılımıyla değerlendirildi; ücretli araçlar gerçek API anahtarlarıyla çalıştırıldı. Ürün adlarının açıklandığı ayrıntılı rapor gizlilik sözleşmesiyle paylaşılır.