Otomatik CV eleme, önce ayrıştırma (parsing) ile başlar: serbest metin hâlindeki bir CV'yi ad, deneyim, eğitim, yetkinlik gibi alanlara bölmek. Bu adım kötü çalışıyorsa sonraki her şey — puanlama, eşleştirme, sıralama — bozuk veriyle çalışır.
Türkçe CV'lerde bu adım, global araçlarda beklenenden sık aksıyor. Sebepleri teknik ama sonuçları çok somut: iyi bir aday, adı yanlış ayrıştırıldığı için havuzda kaybolabiliyor.
Nerede aksıyor
Karakter ve büyük/küçük harf. Türkçe'nin noktalı ve noktasız i harfi, pek çok sistemde beklenmedik sonuçlar üretir. İSTANBUL kelimesini küçültmek, doğru yapılmazsa istanbul vermez. Bu, arama ve eşleştirmeyi sessizce bozar — hata vermez, sadece eşleşmez.
Eklerin kelimeye yapışması. Türkçe sondan eklemeli bir dil. "Ankara'da", "yazılımcıyım", "müdürlüğünde" gibi biçimler, kelime sınırına göre çalışan eşleştiricilerde tutmaz. İngilizce'de "in Ankara" iki ayrı kelimeyken Türkçe'de tek kelimedir.
Unvan çeşitliliği. Aynı iş için "Yazılım Uzmanı", "Yazılım Geliştirme Uzmanı", "Software Developer", "Kıdemli Yazılımcı" hepsi kullanılır. Türkiye'de unvanlar standart değildir ve şirketten şirkete anlamı değişir.
Tarih formatı. 12.03.2019 ve 03/12/2019 farklı okunur. Deneyim süresi hesaplaması buradan kayar.
Yerel alanlar. Askerlik durumu, ehliyet sınıfı, KPSS puanı gibi alanlar global şablonlarda yoktur; ayrıştırıcı bunları ya atlar ya da yanlış alana koyar.
Eğitim seviyeleri. "Ön Lisans", "Lisans", "Yüksek Lisans" ayrımı ile "Associate / Bachelor / Master" eşleşmesi her araçta doğru kurulmuş değildir.
Şablon çeşitliliği. Türkiye'de CV'ler çok farklı şablonlarla hazırlanır — tablo içine yazılmış, iki sütunlu, grafik ağırlıklı. Tablo tabanlı CV'ler ayrıştırıcıların klasik zayıf noktasıdır.
Bunun pratik sonucu
Ayrıştırma hatası şu şekilde görünür:
- Aday adı olarak şirket adı ya da "Özgeçmiş" kelimesi kaydedilir
- Toplam deneyim süresi yanlış hesaplanır, kıdem filtreleri yanlış çalışır
- Yetkinlik listesi eksik çıkar, aday alakasız görünür
- İki farklı format aynı adayı iki kayıt olarak oluşturur
En tehlikelisi sonuncusu değil, hata vermeden yanlış çalışması. Sistem 60 adayı sıralar, siz ilk 10'a bakarsınız, en iyi aday ayrıştırma hatası yüzünden 45. sıradadır ve bunu hiç öğrenmezsiniz.
Nasıl test edilir
Bir aracı satın almadan önce yapılabilecek en bilgilendirici test bu ve on dakika sürüyor:
- Kendi arşivinizden 15 gerçek Türkçe CV seçin. Farklı şablonlar olsun: bir tanesi tablo tabanlı, bir tanesi iki sütunlu, bir tanesi taranmış PDF.
- Sağlayıcıdan bunları sisteme yüklemesini ve ayrıştırılmış çıktıyı göstermesini isteyin.
- Şunları sayın: ad-soyad kaçında doğru? Toplam deneyim kaçında doğru? Eğitim kaçında doğru? Yetkinlik listesi kaçında eksiksiz?
Sonucu bir yüzdeye çevirin ve iki farklı sağlayıcıyı bu sayıyla karşılaştırın. Özellik listesinden çok daha ayırt edici olur.
Ek bir test: aynı adayın iki farklı formatta CV'sini yükleyin. Sistem bunları aynı kişi olarak tanıyor mu, yoksa iki kayıt mı oluşturuyor?
Ne yapılabilir
Eşiği tek başına kullanmayın. Otomatik puanlamayı sıralama için kullanın, kesme için değil. Eşiğin hemen altında kalan 10 adayı elle gözden geçirmek, sistemin nerede hata yaptığını gösteren en ucuz kontroldür.
İlan metnini sadeleştirin. Aşırı spesifik ve jargonlu ilan metinleri eşleştirmeyi zorlaştırır. Aradığınız yetkinlikleri açık ve yaygın kullanılan adlarıyla yazın.
Yapılandırılmış alan isteyin. Başvuru formunda kritik bilgileri (deneyim yılı, çalışma tercihi, şehir) ayrı alan olarak sormak, ayrıştırmaya bağımlılığı azaltır. Ama formu uzatmayın — her ek alan başvuru terkini artırır.
Ayrıştırma hatalarını düzeltilebilir tutun. İyi sistemler yanlış ayrıştırılmış alanı elle düzeltmenize izin verir. Bu küçük bir özellik gibi görünür ama uzun vadede veri kalitesini belirler.
Türkçe CV ayrıştırma, satın alma kararında en kolay ölçülen ama en az test edilen konulardan biri. Demo ekranı yerine kendi arşivinizle yapılan on dakikalık bir denemeyle net bir cevap alabilirsiniz.