KARAR ARACI · 12 KONTROL · 6 KIRMIZI BAYRAK

AI ajanı risk değerlendirme testi

Bu test, ajanın ne kadar etkileyici plan yaptığına değil; hangi veriyi okuyabildiği, hangi işlemi yapabildiği, insanın nerede müdahale ettiği ve hata hâlinde sistemin nasıl durdurulup geri alınabildiğine odaklanır.

Kurumsal yayın: Vatansever Bilişim A.Ş.Sürüm: 1.0Gözden geçirme: 27 Temmuz 2026Süre: 10–15 dakika
ARAÇ NE YAPAR?

On iki ağırlıklı kontrol, ajan sisteminin görev sınırı, kimlik, araç kullanımı, insan gözetimi ve canlı izleme temelini puanlar. Altı kritik kırmızı bayrak toplam skordan bağımsız güvenlik uyarısı üretir.

Ağırlıklı ajan kontrol modeli

On iki kontrol toplam yüzde 100 ağırlığa sahiptir ve 0–4 arasında puanlanır. Sonuç, ajanın yetenek seviyesini değil kontrol hazırlığını gösterir. Kritik kırmızı bayraklar toplam skordan bağımsız canlı kullanım uyarısı üretir.

01

Görev sınırı ve işlem etkisi

Ajanın görevini, izinli eylemlerini, etki sınıflarını ve tamamlanma/durma koşullarını yazılı sözleşmeye dönüştürün.

02

Kimlik, yetki ve veri erişimi

Ayrı iş yükü kimliği, en az yetki, salt okuma/yazma ayrımı ve kısa ömürlü kimlik bilgileri uygulayın.

03

Araç, girdi ve entegrasyon güvenliği

Güvenilmeyen girdiyi izole edin; her araç çağrısını şema, hedef, parametre ve politika bakımından doğrulayın.

04

İnsan kontrolü ve geri alınabilirlik

Yüksek etkili işlemleri insan onayına bağlayın; limit, önizleme, geri alma ve devre kesici kurun.

05

Kayıt, test ve olay yönetimi

Adım bazlı kayıt, senaryo testi, kırmızı takım, kill switch ve olay müdahale tatbikatını canlı işletime ekleyin.

Gizlilik: Form bir sunucuya gönderilmez. Hesaplama cihazınızdaki tarayıcıda yapılır; cevaplar kalıcı olarak saklanmaz.

Öz değerlendirmeyi başlatın

Bütün soruları mevcut durumu abartmadan yanıtlayın. “Belgeli” veya “ölçülüyor” seçeneği için uygulanabilir kanıt bulunması gerekir.

01

Görev ve tamamlanma sınırı

Ajanın hedefi, izinli adımları, yasakları ve durma koşulları açıkça tanımlı mı?

Ağırlık %8
02

İşlem envanteri ve etki sınıfı

Okuma, taslak, gönderme, güncelleme, ödeme veya silme gibi eylemler etki seviyesine göre sınıflandırıldı mı?

Ağırlık %8
03

İş yükü kimliği

Ajan, paylaşılan insan hesabı yerine izlenebilir ve iptal edilebilir ayrı kimlikle çalışıyor mu?

Ağırlık %10
04

En az yetki ve kapsam

Veri, sistem, tenant, kullanıcı, işlem ve zaman yetkileri görevle sınırlı mı?

Ağırlık %10
05

Salt okuma ve yazma ayrımı

Bilgi toplama ile gerçek sistemde değişiklik yapma yetkileri ayrıştırıldı mı?

Ağırlık %8
06

Güvenilmeyen girdi izolasyonu

E-posta, web, belge ve kullanıcı içeriği talimat değil veri olarak ele alınıyor mu?

Ağırlık %8
07

Araç şeması ve çıktı doğrulama

Araç çağrıları parametre, hedef, miktar ve politika bakımından deterministik doğrulanıyor mu?

Ağırlık %8
08

Risk bazlı insan onayı

Yüksek etkili, dışa dönük veya geri alınamaz işlemler gerçek insan onayına bağlı mı?

Ağırlık %10
09

Geri alma ve işlem limiti

Yanlış işlemi geri alma, miktar/adım limiti ve devre kesici mekanizmaları var mı?

Ağırlık %8
10

Uçtan uca denetim izi

Hedef, model kararı, araç çağrısı, kullanıcı, onay ve sonuç olay bazında kaydediliyor mu?

Ağırlık %8
11

Senaryo testi ve kırmızı takım

Normal görevlerin yanında prompt injection, yetki aşımı, hata ve tedarikçi değişimi test ediliyor mu?

Ağırlık %7
12

Kill switch ve olay müdahale

Ajanı, kimliğini veya belirli aracını hızla durdurma; olayı inceleme ve geri dönme süreci var mı?

Ağırlık %7
Kritik kırmızı bayraklar

Aşağıdaki durumlardan biri varsa toplam puandan bağımsız olarak karar koşullu kabul edilir.

Yorumlama sınırları

  • Sonuç pentest, model güvenlik testi, bağımsız denetim veya güvenli kullanım garantisi değildir.
  • Aynı ajan farklı araç, veri, kullanıcı veya işlem limitiyle farklı risk profiline sahip olur.
  • Yüksek skor, prompt injection veya model hatasının tamamen engellendiği anlamına gelmez.
  • Beyanlar kimlik politikası, araç şeması, log, senaryo testi ve gerçek işlem gözlemiyle doğrulanmalıdır.
Yayın sorumluluğu: Bu araç kişisel yazar profili kullanılmadan Vatansever Bilişim Anonim Şirketi kurumsal yayın sorumluluğunda hazırlanmıştır. Sonuç genel karar desteğidir; belirli bir kurum için sertifika, hukuki görüş, yatırım tavsiyesi, güvenlik veya sonuç garantisi değildir.
İLGİLİ HİZMET

AI ajanı kontrol modelini gerçek görev ve yetkilerle doğrulayın.

Araç ilk risk görünümünü sağlar; kimlik, entegrasyon, onay ve olay senaryoları çalışma kopyasında teknik test gerektirir.