Siber Güvenlik

Prompt Enjeksiyonu Savunması ve Katmanlı Kontroller

Sezer Koçer

1 dk okuma

Prompt enjeksiyonu savunması

Özet

Doğrudan ve dolaylı enjeksiyon, araç yetkisi ve çıktı filtreleri. Red team ve sürekli test.

Tehdit modeli

Prompt injection: kullanıcı veya harici içerik, system talimatını override etmeye çalışır. Dolaylı enjeksiyon RAG dokümanında gizli talimat. 2026’da OWASP LLM Top 10 listesinde üst sırada.

Katmanlı savunma

Input sanitization yetersiz; policy engine + output filter + tool izinleri birlikte. Privileged action ayrı onay.

Tool güvenliği

Ajan araçları allowlist; shell/exec kapalı veya sandbox. Parametre schema strict validation.

RAG özel

Retrieved chunk’larda instruction pattern tarama. Source attribution ile kullanıcıya şüpheli kaynak göster.

Eğitim ve simülasyon

Red team playbook güncel. Otomatik jailbreak generator CI’da. Regression yeni model sürümünde.

Logging

Attack denemeleri SIEM’e; PII redaction. Retention compliance.

Model seçimi

Instruction-hardened modeller riski azaltmaz, sıfırlamaz. Defense in depth.

İnsan döngüsü

Finansal transfer, silme, dış e-posta insan onayı. UI’da net ayrım user vs system.

Sonuç

Prompt injection’a karşı %100 garanti yok; hasarı sınırla. En az ayrıcalık ve sürekli test 2026 standardı.