On iki ağırlıklı kontrol, ajan sisteminin görev sınırı, kimlik, araç kullanımı, insan gözetimi ve canlı izleme temelini puanlar. Altı kritik kırmızı bayrak toplam skordan bağımsız güvenlik uyarısı üretir.
Ağırlıklı ajan kontrol modeli
On iki kontrol toplam yüzde 100 ağırlığa sahiptir ve 0–4 arasında puanlanır. Sonuç, ajanın yetenek seviyesini değil kontrol hazırlığını gösterir. Kritik kırmızı bayraklar toplam skordan bağımsız canlı kullanım uyarısı üretir.
Görev sınırı ve işlem etkisi
Ajanın görevini, izinli eylemlerini, etki sınıflarını ve tamamlanma/durma koşullarını yazılı sözleşmeye dönüştürün.
Kimlik, yetki ve veri erişimi
Ayrı iş yükü kimliği, en az yetki, salt okuma/yazma ayrımı ve kısa ömürlü kimlik bilgileri uygulayın.
Araç, girdi ve entegrasyon güvenliği
Güvenilmeyen girdiyi izole edin; her araç çağrısını şema, hedef, parametre ve politika bakımından doğrulayın.
İnsan kontrolü ve geri alınabilirlik
Yüksek etkili işlemleri insan onayına bağlayın; limit, önizleme, geri alma ve devre kesici kurun.
Kayıt, test ve olay yönetimi
Adım bazlı kayıt, senaryo testi, kırmızı takım, kill switch ve olay müdahale tatbikatını canlı işletime ekleyin.
Öz değerlendirmeyi başlatın
Bütün soruları mevcut durumu abartmadan yanıtlayın. “Belgeli” veya “ölçülüyor” seçeneği için uygulanabilir kanıt bulunması gerekir.
—
Öncelikli gelişim alanları
Yorumlama sınırları
- Sonuç pentest, model güvenlik testi, bağımsız denetim veya güvenli kullanım garantisi değildir.
- Aynı ajan farklı araç, veri, kullanıcı veya işlem limitiyle farklı risk profiline sahip olur.
- Yüksek skor, prompt injection veya model hatasının tamamen engellendiği anlamına gelmez.
- Beyanlar kimlik politikası, araç şeması, log, senaryo testi ve gerçek işlem gözlemiyle doğrulanmalıdır.