Argus QA — Avtonom reqressiya testi
Biznes prosesini adi dildə təsvir edin — computer-use agentləri onu real interfeysdə addım-addım icra etsin. Skript yazmadan, interfeys dəyişəndə isə onu yenidən yazmadan; hər addım skrinşot və agentin mühakiməsi ilə saxlanılır.
Əsas Xüsusiyyətlər
Koordinatsız Ssenarilər
Ssenarilər rol, iddialar, addım büdcəsi və vaxt limiti olan versiyalanmış YAML məqsədlərindən ibarətdir. Agent ekranı müşahidə edir, mühakiməsini açıq şəkildə qeydə alır və hər növbədə yalnız bir hərəkət edir; hər addım nəticəsindən asılı olmayaraq saxlanılır.
Çox Rollü İş Axını
Yaradıcı, təsdiqçi və təchizatçı kimi müxtəlif rollar hər biri ayrı, müstəqil autentifikasiya edilmiş brauzer sessiyasında icra edilir. İcra əhatəli test məlumatı adlandırması sayəsində paralel agentlər paylaşılan mühitdə toqquşmadan işləyir.
Təhlükəsiz Giriş və Məlumat İdarəetməsi
Giriş əməliyyatı həmişə deterministik skript tərəfindən həyata keçirilir, agent tərəfindən heç vaxt. Etimadnamələr şifrəli saxlancdan oxunur. Test məlumatları hər icra üçün ayrıca adlandırılır ki, paralel işlər bir-birinə mane olmasın.
İki Pilləli Model İcrası
Əvvəlcə daha sərfəli model işləyir; yalnız agent tərəfli uğursuzluqlarda daha güclü modelə bir eskalasiya cəhdi edilir. Model seçimi verilənlər bazasında saxlanılır və növbəti iş vahidindən etibarən dərhal qüvvəyə minir — yenidən yerləşdirməyə ehtiyac yoxdur.
Müstəqil Yoxlayıcı və Qüsur Hesabatı
İddiaları işi yerinə yetirən agent deyil, müstəqil yoxlayıcı yoxlayır. Şübhəli məhsul qüsuru hazır hesabatla işarələnir; insan nəzərdən keçirir və qeydə alır — AI öz başına qüsur elan etmir.
Marşrut Yaddaşı və Model Agnostikliyi
Uğurlu icra öz yolunu addım niyyətləri şəklində — heç vaxt koordinat kimi deyil — saxlayır və sonrakı icralar üçün məsləhət kimi təklif edir. Koordinat əsaslandırma sahəsi, mühakimə səyi və provayder yönləndirməsi konfiqurasiya ilə idarə olunur; model kataloqları hər provayderın öz endpoint-indən canlı oxunur, vizual dəstək avtomatik yoxlanılır.
Necə İşləyir?
Tez-tez Verilən Suallar
Argus QA mövcud avtomatlaşdırma alətlərini əvəz edirmi?
Xeyr, tamamlayır. Sabit, yaxşı müəyyənləşdirilmiş axınlar üçün deterministik skriptlər daha sürətli və etibarlıdır. Argus QA isə uzun, çox rollü, tez-tez dəyişən axınlar üçün nəzərdə tutulub — bu iki yanaşma bir-birini tamamlayır.
İnterfeys dəyişdikdə ssenarilər yenidən yazılmalıdırmı?
Xeyr. Ssenarilər selektor və ya koordinat deyil, məqsəd əsaslı olduğundan agent hər icrada ekranı yenidən qiymətləndirir. UI dəyişiklikləri ssenarinizi köhnəltmir; yalnız iş məntiqinin özü dəyişdikdə ssenarini yeniləmək lazım gəlir.
Paralel icralarda test məlumatları bir-birinə qarışırmı?
Xeyr. Argus QA icra əhatəli test məlumatı adlandırması tətbiq edir: hər paralel agent öz unikal adlandırma prefiksi ilə işləyir, buna görə paylaşılan mühitdə eyni anda bir neçə agent işləsə belə məlumatlar toqquşmur.
Model xərcləri nə qədərdir və necə izlənilir?
25 ssenaridən ibarət tam dəst üçün ölçülmüş model xərci icra başına 0,4–2,3 dollar arasında olmuşdur — bu, cari mərhələdəki ölçmə hədəfidir, xidmət səviyyəsi zəmanəti deyil. Xərclər hər API zəngindən addıma, ssenaridən buraxılışa qədər toplanır və veb interfeysindən izlənilir.
Hansı AI modelləri dəstəklənir və model dəyişdirmək üçün yenidən yerləşdirmə lazımdırmı?
Argus QA model agnostikdir: koordinat əsaslandırma sahəsi, mühakimə səyi və provayder yönləndirməsi konfiqurasiya ilə idarə olunur, kod dəyişikliyi tələb etmir. Model kataloqları hər provayderın öz endpoint-indən canlı oxunur; vizual dəstək və koordinat əsaslandırma imkanları avtomatik yoxlanılır — bəzi routerlarda mövcud modellərin yalnız bir hissəsi şəkil qəbul edir. Model seçimi verilənlər bazasında saxlanılır və növbəti iş vahidindən etibarən dərhal qüvvəyə minir, yenidən yerləşdirməyə ehtiyac yoxdur.
Argus QA ilə Tanış Olun
Komandanızın test prosesini necə dəyişdirə biləcəyini görmək üçün bizimlə əlaqə saxlayın. Argus QA-nı öz mühitinizdə sınaqdan keçirin.
Demo tələb edin