Prompt Enjeksiyonu Savunması ve Katmanlı Kontroller
Sezer Koçer
1 dk okuma

Özet
Doğrudan ve dolaylı enjeksiyon, araç yetkisi ve çıktı filtreleri. Red team ve sürekli test.
Tehdit modeli
Prompt injection: kullanıcı veya harici içerik, system talimatını override etmeye çalışır. Dolaylı enjeksiyon RAG dokümanında gizli talimat. 2026’da OWASP LLM Top 10 listesinde üst sırada.
Katmanlı savunma
Input sanitization yetersiz; policy engine + output filter + tool izinleri birlikte. Privileged action ayrı onay.
Tool güvenliği
Ajan araçları allowlist; shell/exec kapalı veya sandbox. Parametre schema strict validation.
RAG özel
Retrieved chunk’larda instruction pattern tarama. Source attribution ile kullanıcıya şüpheli kaynak göster.
Eğitim ve simülasyon
Red team playbook güncel. Otomatik jailbreak generator CI’da. Regression yeni model sürümünde.
Logging
Attack denemeleri SIEM’e; PII redaction. Retention compliance.
Model seçimi
Instruction-hardened modeller riski azaltmaz, sıfırlamaz. Defense in depth.
İnsan döngüsü
Finansal transfer, silme, dış e-posta insan onayı. UI’da net ayrım user vs system.
Sonuç
Prompt injection’a karşı %100 garanti yok; hasarı sınırla. En az ayrıcalık ve sürekli test 2026 standardı.