Blog

AI ajanına ne kadar güvenmeli? 4 otonomi seviyesi modeli

SemAgent Ekibi · 2026-07-08 · 7 dk okuma

Kısa cevap: "Ajana güvenilir mi?" yanlış sorudur. Doğru soru şu: "hangi aksiyona, hangi koşulda, ne kadar güvenilir?" Cevabı katmanlı bir güven modeli verir — ve bu modelin yeri prompt değil, koddur.

Neden prompt kuralı yetmez?

"Asla onaysız e-posta gönderme" cümlesini sistem prompt'una yazabilirsiniz — ama prompt bir güvenlik sınırı değildir. Ajanın okuduğu bir web sayfası, bir e-posta, bir doküman ona ters talimat enjekte edebilir (prompt injection). Güvenlik, modelin ikna edilemeyeceği yerde durmalıdır: araç çağrısı katmanında.

Katmanlı model: her araç çağrısında 4 soru

  1. Yetenek açık mı? Bu araç ailesi (okuma / yazma) bu çalışma alanında etkin mi?
  2. Hedef listede mi? E-posta alan adı, HTTP hedefi, DB hedefi allow-list'te mi? Değilse çalıştırma — ajan ne kadar "ikna olmuş" olursa olsun.
  3. Risk sınıfı ne? Aynı araç farklı argümanla farklı risktir: kendi takvimine etkinlik eklemek ≠ müşteriye e-posta göndermek.
  4. Otonomi eşiği aşılıyor mu? Kullanıcının seçtiği seviyeye göre ya çalıştır ya onay iste.

4 seviye pratikte

Güvenin ölçülebilir hâli

Bu modelin güzel bir yan etkisi var: her şey denetlenebilir olur. Her karar — çalıştı, onay istedi ya da reddedildi — loglanır; "Ajan ne yaptı?" sorusunun cevabı duygu değil, kayıttır. SemAgent'taki uygulama için: AI Agent · otonomi rehberi · Trust Center.

Okumak yerine denemek isterseniz

7 gün ücretsiz deneyin — kart gerekli, 5 dakikada kendi içeriğinizle test edin.

Ücretsiz dene
İstediğiniz an iptal