Türkçe NLP
PII Detection
Token Vault
Human-in-the-loop
PostgreSQL
AI Security
Yerel güvenli MVP · Sentetik veriler
Türkçe PII Korumalı Güvenli AI Chat
Üretken yapay zeka destekli chat sistemlerinde kişisel veri güvenliği yalnızca metindeki hassas alanları maskelemekten ibaret değil. Verinin hangi servislere ulaştığı, token eşleşmelerinin nerede saklandığı, frontend'in hangi bilgilere erişebildiği ve etkili işlemlerin insan onayı olmadan çalıştırılıp çalıştırılamadığı da güvenlik sınırının bir parçası.
Bu problem için Türkçe PII tespiti, PLACEHOLDER ve TOKENIZED koruma modları, PostgreSQL üzerinde şifreli Token Vault ve yüksek riskli işlemler için ikinci onay mekanizması içeren yerel bir AI chat MVP'si geliştirdim. tr_core_news_trf modeli ile yapısal veri kurallarını birlikte kullanarak TCKN, IBAN, telefon ve benzeri biçimsel alanlarda hibrit bir yaklaşım kurdum.
Sistemi yalnızca başarılı API cevaplarıyla değerlendirmedim. Ham veya korunmuş hassas verinin görünür DOM, frontend API cevapları, console, local storage, session storage, IndexedDB ve browser network trafiğinde bulunup bulunmadığını ayrı ayrı kontrol ettim. Ortaya çıkan çalışma gerçek dış servislerin bağlı olmadığı, sentetik verilerle çalışan yerel bir MVP'dir.
- PROBLEM
- AI chat sistemlerinde kullanıcıların yazdığı TCKN, IBAN, e-posta ve sipariş gibi kişisel verilerin model, log veya tarayıcı katmanlarına kontrolsüz biçimde taşınması güvenlik riski oluşturuyordu.
- YAKLAŞIM
- Türkçe PII'yı model çağrısından önce tespit eden; senaryoya göre placeholder veya şifreli token ile koruyan bir veri akışı geliştirdim. Token eşleşmelerini PostgreSQL üzerinde şifreli Vault'ta tuttum; yüksek riskli işlemleri ikinci kullanıcı onayına bağladım.
- ETKİ
- Tokenlaştırma, sipariş sorgulama, onaylı iptal ve e-posta simülasyonu uçtan uca çalıştı. Test edilen browser yüzeylerinde hassas veri sızıntısı görülmedi. Dört farklı ekran boyutunda yatay taşma oluşmadı.