TL; DR
Pentest hücumçunun nələr edə biləcəyini sübut edir. Süni intellektlə keçən rübdə sınaqdan keçirdiyiniz sistem artıq mövcud deyil. Modellər yeni versiyalar əldə edir, sorğular redaktə olunur, alətlər qoşulur və bunların heç biri kodunuzun bir sətrinə də toxunmur. Süni intellekt pentesti kod yollarından daha çox davranışı hədəfləyir: modelin nə etməyə razı salına biləcəyi, agentin nə çağıra biləcəyi və nəticədə binanı tərk edən şeylər. Əhatə dairəsi artıq LLM Tətbiqləri üçün OWASP Top 10 və Agent Tətbiqləri üçün OWASP Top 10 2026 ilə əlaqələndirilir.
Faydalı yük cümlədir və sorğuda heç bir şey səhv görünmür. Hücum dəstək biletinə, kod şərhinə və ya əldə edilmiş sənədə daxil olduqda fuzz üçün heç bir parametr yoxdur, buna görə də dolayı təcili inyeksiya miqyaslı bir texnikadır: heç kim ön tərəfinizə toxunmamalıdır. Model alətləri saxladıqdan sonra zərər istifadəsinə icazə verilən alətlərdən keçir. Alət sui-istifadəsi, həddindən artıq agentlik və agentin öz inteqrasiyaları vasitəsilə məlumatların sızdırılması vacib olan tapıntılardır, cavabların yaxşı oxunub-oxunmaması deyil.
Bir uğursuz cəhd heç nəyi sübut etmir. Süni intellekt sistemləri ehtimallıdır, buna görə də faydalı nəticə hadisə deyil, sürətdir: bu hücum 100 cəhddən 12-sində uğurlu olub. Hədəf isə modeldən daha genişdir. Sənədləşdirilmiş hücumlar artıq ətrafdakı aktivlərə dəyib: qayda fayllarında gizli Unicode kodu köməkçinin arxa qapıdan çıxış buraxmasına səbəb olur, MCP serverlərində alət zəhərlənməsi və 437,000 dəfədən çox çəkilmiş MCP körpüsü vasitəsilə tam uzaqdan kod icrası. Hər modeldə, sorğuda, alətdə və server dəyişikliyində yenidən sınaqdan keçirmək reallığı əks etdirən yeganə kadensdir.
Sınaq ikinci yerdədir. Görmə birinci yerdədir: Süni intellekt-SPM inventarı və AI-BOM-u qurur, beləliklə hansı agentlərin hansı alətlərə sahib olduğunu və heç kimin təsdiq etmədiyi MCP serverlərini bilirsiniz; AI Təhlükəsizliyi həmin aktivləri OWASP-ın LLM Tətbiqləri üzrə Top 10 siyahısına daxil edir və dəqiq fayl və sətri göstərir, prioritetləşdirmə hunisi isə minlərlə tapıntını istifadədə olan, əlçatan, istismar edilə bilən, imtiyazlı və biznes üçün vacib olanlara qədər daraldır; xy-dast süni intellekt tətbiqinin hələ də işlədiyi veb və API səthini sınaqdan keçirməyə davam edir. Eyni kəşfiyyat, artıq sahib olduğunuz skanerlərdən əldə edilən tapıntılara da aiddir, buna görə də bu, yığınızı əvəz etmək əvəzinə genişləndirir.
Süni intellekt Pentesti nədir?
Süni intellekt pentesti süni intellekt sistemlərinin rəqabətli sınaqdan keçirilməsidir: hücumçunun əslində nə edə biləcəyini sübut etmək üçün hazırlanmış girişləri modelə, agentə və ya MCP serverinə göndərmək. Klassik penetrasiya testi kod yollarını və konfiqurasiyalarını hədəf aldığı halda, süni intellekt penetrasiya testi davranışı hədəf alır: ələ keçirilmiş təlimatlar, sui-istifadə edilmiş alətlər, sızdırılmış kontekst və sistemin heç vaxt etməməsi lazım olan hərəkətlər. Bu, süni intellekt pentestinin nə olduğunun qısa versiyasıdır. Narahatedici, lakin sadə bir səbəbdən ayrı bir intizam olaraq mövcuddur. İllik pentest hesabatınız, arxasındakı modelin əlaqədən bəri üç dəfə dəyişməsi və kodunuzun heç bir sətrinin dəyişməməsi səbəbindən artıq mövcud olmayan bir tətbiqi təsvir edir.
Niyə klassik pentest süni intellekt sahəsini əhatə etmir?
Süni intellekt pentestinin nə olduğunu ilk dəfə soruşan hər kəs adətən buradan, boşluqdan başlayır. Ənənəvi test deterministik davranışı fərz edir. Eyni sorğu göndərilir, eyni cavab alınır və nəticə ya təkrarlanır, ya da olmur. Süni intellekt bu fərziyyəni üç yerdə pozur.
- Sistem ehtimala əsaslanır. Eyni təklif dördüncü cəhddə uğurlu ola bilər və ilk üçündə uğursuz ola bilər. Tək bir mənfi test heç nəyi sübut etmir, buna görə də süni intellekt sistemlərinin pentest edilməsi birdəfəlik istismardan daha çox əhatə dairəsi və təkrar məsələsidir.
- Hücum səthi yalnız interfeyslər deyil, dildir. Faydalı yük dəstək biletindəki bir cümlə, kod şərhi və ya əldə edilmiş sənəd olduqda, fuzz üçün heç bir parametr yoxdur. Sorğuda heç bir şey səhv görünmür.
- Partlayış radiusu alətin səthidir. Alətləri olan agent e-poçt göndərə, verilənlər bazalarına sorğu göndərə, daxili API-lərə zəng edə və fayl yaza bilər. Süni intellekt agentlərinin sınaqdan keçirilməsi, modelin cavablarının nəzakətli olub-olmadığını deyil, həmin alətlərlə nə etməyə inandırıla biləcəyini sınaqdan keçirmək deməkdir.
Süni intellekt pentestinqi əslində nəyi sınaqdan keçirir
Əhatə dairəsi, uyğunlaşdırılmış, tanınan bir sıra məqsədlər ətrafında qərarlaşıb LLM Tətbiqləri üçün OWASP-ın Ən Yaxşı 10-luğu və OWASP Agent Tətbiqləri 2026-cı il üçün Top 10.
- Birbaşa təcili inyeksiya. İstifadəçi sistem sorğusunu ləğv edib modelin davranışını idarə edə bilərmi?
- Dolayı təcili inyeksiya. Təcavüzkar sistemin əldə etdiyi məzmuna təlimatlar yerləşdirə bilərmi ki, heç kim onunla qarşılıqlı əlaqədə olmasın?
- Sistem sorğusunun çıxarılması. Model öz təlimatlarını açıqlayırmı, öz guardrails yoxsa onlara yerləşdirilmiş biznes məntiqi?
- Mühafizə dirəyini aşmaq və jailbreak. Təhlükəsizlik və siyasət qatını neçə cəhd və hansı kodlaşdırma pozur?
- Alət sui-istifadəsi. Model, məsələn, öz elektron poçt aləti vasitəsilə ixtiyari bir alıcıya məlumat göndərmək kimi, hücumçu tərəfindən seçilmiş arqumentlərlə bir aləti çağırmağa sövq edilə bilərmi?
- Həddindən artıq səlahiyyət. Agentin edə biləcəyi ən geniş hərəkət nədir və hər hansı bir əməliyyatı yerinə yetirməzdən əvvəl insan tələb olunurmu?
- Məlumatların çıxarılması yolları. Kontekst, sirrlər və ya şəxsi məlumatlar çıxış kanalına, jurnala və ya üçüncü tərəf alətinə çata bilərmi?
- Qaytarma zəhərlənməsi. Vektor anbarındakı zəhərlənmiş məzmun axın davranışını dəyişirmi və davam edirmi?
- MCP server məruz qalması. Hər bir qoşulmuş server nəyi ifşa edir, arqumentləri doğrulayırmı və başqa kim ona çata bilər?
- Təhlükəsiz çıxış emalı. Model çıxış axını qabığa, brauzerə, sorğuya və ya şablona doğrulanmayıbmı?
Məhz bu siyahı süni intellekt penetrasiya testlərinin fərqli bir hesabat növü yaratmasının səbəbidir. Dəyərli nəticə a deyil CVESüni intellekt pentestinin nə olduğuna dair praktik cavab təkrarlana bilən bir ardıcıllıqdır: bu giriş, bu yolla, bu dəlillərlə birlikdə bu icazəsiz hərəkəti yaratdı.
Artıq işlətdiyinizlə müqayisədə süni intellekt pentesti
| Klassik pentest / DAST | Süni intellekt testi | |
|---|---|---|
| Hədəf | Son nöqtələr, parametrlər, konfiqurasiya | Model davranışı, agent decisionlar, alət çağırışları |
| Payload | Səhv və ya zərərli sorğular | Sistemin əldə etdiyi təbii dil və məzmun |
| Nəticə | Deterministik və təkrarlana bilən | Ehtimallı, dərəcəsi müəyyən etmək üçün təkrar tələb olunur |
| sübut | Sorğu, cavab, CWE | Sistemin gördüyü hərəkəti izləyin, istiqamətləndirin |
| Modulyasiya | Buraxılış başına və ya ildə | Model, sorğu, alət və ya konfiqurasiya dəyişikliyi başına |
Süni intellekt nüfuzetmə testi və klassik işləmə müddəti testi bir-birini tamamlayır, rəqabət aparmır. Süni intellekt tətbiqi hələ də identifikasiya, API və infrastrukturla veb yığında işləyir və bu səthin əvvəlki kimi işləmə müddəti testinə ehtiyacı var. Xygeni DAST əhatə edir: xy-dast işləyən veb tətbiqlərinə və API-lərinə qarşı real hücum texnikalarını simulyasiya edir, arxasındakı testləri həyata keçirir login forma, token, başlıq və ya skript əsaslı identifikasiya ilə istənilən yerdə tək bir CLI əmrindən işə salınır pipeline, Gates, eşik üzərində qurulur və hücum yükünü, üstəgəl tam sorğu və cavabı hər tapıntıya dəlil olaraq qaytarır. Daha sonra tapıntılar prioritetləşdirmə hunisindən keçir və bu hunis internetdə aşkarlanan, etimadnamə olmadan istismar edilə bilən və biznesin maraqlandığı bir şeyə bağlı olanlara filtrlənir.
DAST-ın etmədiyi şey dil modeli ilə mübahisə etməkdir. Bu, süni intellekt pentestinin doldurduğu boşluqdur.
İlk yükdən əvvəl
Süni intellekt pentestini teatral deyil, faydalı edən iki şey var və hər ikisi ilk faydalı yükdən əvvəl gəlir.
- Hədəf siyahısı. Tapmadığınız süni intellekt test edə bilməzsiniz. Xygeni AI Security bütün süni intellekt aktivlərini aşkar edir SDLC, o cümlədən modellər, agentlər, agent serverləri, məlumat dəstləri, MCP serverləri, bacarıq faylları, sorğular və guardrails nobody declared, tətbiq kodunu, elan edilmiş asılılıqları və süni intellekt alətlərinin geridə qoyduğu konfiqurasiya fayllarını oxuyur. Bu, onlar arasındakı əlaqələri xəritələşdirir və bu da aktivlərin siyahısını sınaqdan keçirməyə dəyər bir hücum yoluna çevirir.
- Qısa siyahı. Xygeni, hər kəs istismara cəhd etməzdən əvvəl istismar ehtimalını artıran zəif cəhətləri aşkarlayır: sürətli inyeksiya və sistem sorğusunun sızması, qaydalarda və bacarıq fayllarında zərərli təlimatlar və alət inyeksiyası, təhlükəsiz olmayan MCP konfiqurasiyası, həddindən artıq agentlik və itkinlik guardrails, süni intellekt fayllarında sirlər və həssas və ya yavaş-yavaş yerləşmiş süni intellekt asılılıqları. Tapıntılar LLM Tətbiqləri üçün OWASP Top 10-a uyğunlaşdırılır və dəqiq fayla və sətirə yönəldilir və prioritetləşdirmə hunisi minlərlə tapıntını istifadədə olan, əlçatan, istismar edilə bilən, imtiyazlı və biznes üçün vacib olan bir ovuc tapıntıya qədər daraldır.
Bu ardıcıllıqla işləyin və pentest balıq ovu ekspedisiyası olmaqdan çıxır. Hansı agentin hansı alətlərə sahib olduğunu, hansı serverin heç kimin təsdiq etmədiyini və hansı sorğunun etibarsız girişi qəbul etdiyini bilərək gəlirsiniz.
Faydalı bir şey yaradan süni intellekt pentestini necə işə salmaq olar
Faydalı süni intellekt penetrasiya testini demo versiyasından ayıran yeddi vərdiş var və süni intellekt tətbiqlərinin penetrasiya testində təcrübəsiz komandalar ilk ikisini atlamağa meyllidirlər.
- Əvvəlcə inventar Modellər, agentlər, MCP serverləri, məlumat dəstləri, sorğular. Naməlum bir səthin sınaqdan keçirilməsi naməlum nəticə verir.
- İcazəsiz nə demək olduğunu müəyyənləşdirin Sistemin heç vaxt etməməli olduğu hərəkətləri yazın. Bu siyahı olmadan hər bir tapıntı rəy məsələsidir.
- Yalnız söhbət qutusunu deyil, axtarış yolunu da sınaqdan keçirin Dolayı inyeksiya, miqyaslı bir texnikadır və heç vaxt ön tərəfinizə toxunmur.
- Hadisələri deyil, dərəcələri ölçün Hücumun 100 cəhddən 12-sində uğurlu olduğunu bildirin, çünki bu, mühəndisin hərəkət edə biləcəyi və lövhənin başa düşə biləcəyi rəqəmdir.
- Konfiqurasiya qatını da sınaqdan keçirin Süni intellekt konfiqurasiyasını oxumadan onun sınağı yarım sınaq və sürətli sərtləşdirmə məşqidir.cisQaydalar faylı onu səssizcə ləğv edərsə, e boşa çıxır.
- Dəyişiklik zamanı yenidən test edin Yeni model versiyası, yeni alət, yeni MCP serveri və ya redaktə edilmiş sorğu, hamısı son nəticəni etibarsız edir.
- Nəticələri duruşa qaytarın PDF-də olan tapıntı heç nəyi dəyişmir. Onu yaradan aktivlə əlaqəli tapıntı prioritetləri dəyişir.
FAQ
- Süni intellekt pentesti nədir, bir cümlə ilə? Təcavüzkarın modellərinizin, agentlərinizin və MCP serverlərinizin əslində nələr edə biləcəyini sübut edən rəqib testi.
- Süni intellekt pentesti, süni intellekt qırmızı komandalaşması ilə eynidirmi? Onlar çox üst-üstə düşür. Qırmızı komanda daha genişdir və tez-tez təhlükəsizlik, qərəz və sui-istifadə ssenarilərini əhatə edir; Süni intellekt pentesti, adətən, inyeksiya, məlumatların açıqlanması və icazəsiz hərəkətlər kimi təhlükəsizlik nəticələrinə yönəlir.
- Süni intellektdən istifadə veb tətbiqini sınaqdan keçirməkdən nə ilə fərqlənir? Faydalı yük dildir, nəticə ehtimaldır və zərər həssas kod yolu ilə deyil, modelin istifadəsinə icazə verilən alətlər vasitəsilə baş verir.
- Süni intellekt penetrasiya testi nə qədər tez-tez aparılmalıdır? Davranışa təsir edən hər bir dəyişiklikdə: model versiyası, sorğu, alət səthi, qoşulmuş MCP serveri və ya axtarış korpusu. İllik kadensiya artıq mövcud olmayan bir sistemi təsvir edir.
- Süni intellekt pentestini keçirsək, yenə də DAST-a ehtiyacımız varmı? Bəli. Tətbiq, onun API-ləri və infrastrukturu hədəf olaraq qalır. Süni intellekt pentestinqi bir təbəqə əlavə edir; o, aşağıdakı təbəqəni əvəz etmir.
- Əvvəlcə nəyi sınamalıyıq? Ən geniş alət səthinə malik agent və təşkilat xaricindəki məzmunun bir sorğuya çatdığı hər hansı bir yol.
Görə biləcəyiniz şeylərdən başlayın
Süni intellekt pentestinin nə olduğuna dair cavab bir suala bağlıdır: bu istismar edilə bilərmi və kim tərəfindən? Faydalı cavab almaq əvvəlcə nəyin mövcud olduğunu bilməkdən asılıdır, çünki natamam inventara qarşı hücum simulyasiyası məruz qalma ehtimalınızı deyil, görünürlüğünüzü ölçür.
Xygeni sizin içinizdə süni intellekt aşkar edir SDLC, həqiqətən istismar edilə bilənləri qiymətləndirir və siyasəti tərtibatçıların son nöqtəsində tətbiq edir, burada siyasətin əksəriyyəti əslində işləyir. Agentlərinizin nə ilə əlaqəli olduğuna baxın Xygenie.







