Məhsullar · Argus QA

Argus QA — Avtonom reqressiya testi

Biznes prosesini adi dildə təsvir edin — computer-use agentləri onu real interfeysdə addım-addım icra etsin. Skript yazmadan, interfeys dəyişəndə isə onu yenidən yazmadan; hər addım skrinşot və agentin mühakiməsi ilə saxlanılır.

Əsas Xüsusiyyətlər

Koordinatsız Ssenarilər

Ssenarilər rol, iddialar, addım büdcəsi və vaxt limiti olan versiyalanmış YAML məqsədlərindən ibarətdir. Agent ekranı müşahidə edir, mühakiməsini açıq şəkildə qeydə alır və hər növbədə yalnız bir hərəkət edir; hər addım nəticəsindən asılı olmayaraq saxlanılır.

Çox Rollü İş Axını

Yaradıcı, təsdiqçi və təchizatçı kimi müxtəlif rollar hər biri ayrı, müstəqil autentifikasiya edilmiş brauzer sessiyasında icra edilir. İcra əhatəli test məlumatı adlandırması sayəsində paralel agentlər paylaşılan mühitdə toqquşmadan işləyir.

Təhlükəsiz Giriş və Məlumat İdarəetməsi

Giriş əməliyyatı həmişə deterministik skript tərəfindən həyata keçirilir, agent tərəfindən heç vaxt. Etimadnamələr şifrəli saxlancdan oxunur. Test məlumatları hər icra üçün ayrıca adlandırılır ki, paralel işlər bir-birinə mane olmasın.

İki Pilləli Model İcrası

Əvvəlcə daha sərfəli model işləyir; yalnız agent tərəfli uğursuzluqlarda daha güclü modelə bir eskalasiya cəhdi edilir. Model seçimi verilənlər bazasında saxlanılır və növbəti iş vahidindən etibarən dərhal qüvvəyə minir — yenidən yerləşdirməyə ehtiyac yoxdur.

Müstəqil Yoxlayıcı və Qüsur Hesabatı

İddiaları işi yerinə yetirən agent deyil, müstəqil yoxlayıcı yoxlayır. Şübhəli məhsul qüsuru hazır hesabatla işarələnir; insan nəzərdən keçirir və qeydə alır — AI öz başına qüsur elan etmir.

Marşrut Yaddaşı və Model Agnostikliyi

Uğurlu icra öz yolunu addım niyyətləri şəklində — heç vaxt koordinat kimi deyil — saxlayır və sonrakı icralar üçün məsləhət kimi təklif edir. Koordinat əsaslandırma sahəsi, mühakimə səyi və provayder yönləndirməsi konfiqurasiya ilə idarə olunur; model kataloqları hər provayderın öz endpoint-indən canlı oxunur, vizual dəstək avtomatik yoxlanılır.

Necə İşləyir?

1Ssenarini adi dildə YAML məqsədi kimi yazın: rol, iddialar, addım büdcəsi və vaxt limitini müəyyənləşdirin — selektor və ya koordinat tələb olunmur.
2Argus QA hər rol üçün müstəqil autentifikasiya edilmiş brauzer sessiyası açır; giriş həmişə deterministik skriptlə həyata keçirilir, etimadnamələr şifrəli saxlancdan oxunur.
3Agent ekranın skrinşotunu alır, mühakiməsini açıq şəkildə qeydə alır və hər növbədə bir hərəkət edir — hər addım nəticəsindən asılı olmayaraq saxlanılır.
4İddiaları müstəqil yoxlayıcı yoxlayır; hər uğursuzluq məhsul qüsuru, agent uğursuzluğu, mühit xətası, iddia uğursuzluğu, döngü, addım limiti və ya vaxt aşımı kimi avtomatik təsnif edilir.
5Şübhəli məhsul qüsuru aşkar edildikdə sistem hazır hesabat yaradır və insan nəzərdən keçirməsi üçün işarələyir; AI heç vaxt öz başına qüsur elan etmir.
6Model xərcləri hər zəngdən buraxılış səviyyəsinə qədər toplanır; ssenarilər, dəstlər və paylaşılan tətbiq qeydləri veb interfeysindən redaktə edilə bilər, saxlanarkən sxemə qarşı yoxlanılır.

Tez-tez Verilən Suallar

Argus QA mövcud avtomatlaşdırma alətlərini əvəz edirmi?

Xeyr, tamamlayır. Sabit, yaxşı müəyyənləşdirilmiş axınlar üçün deterministik skriptlər daha sürətli və etibarlıdır. Argus QA isə uzun, çox rollü, tez-tez dəyişən axınlar üçün nəzərdə tutulub — bu iki yanaşma bir-birini tamamlayır.

İnterfeys dəyişdikdə ssenarilər yenidən yazılmalıdırmı?

Xeyr. Ssenarilər selektor və ya koordinat deyil, məqsəd əsaslı olduğundan agent hər icrada ekranı yenidən qiymətləndirir. UI dəyişiklikləri ssenarinizi köhnəltmir; yalnız iş məntiqinin özü dəyişdikdə ssenarini yeniləmək lazım gəlir.

Paralel icralarda test məlumatları bir-birinə qarışırmı?

Xeyr. Argus QA icra əhatəli test məlumatı adlandırması tətbiq edir: hər paralel agent öz unikal adlandırma prefiksi ilə işləyir, buna görə paylaşılan mühitdə eyni anda bir neçə agent işləsə belə məlumatlar toqquşmur.

Model xərcləri nə qədərdir və necə izlənilir?

25 ssenaridən ibarət tam dəst üçün ölçülmüş model xərci icra başına 0,4–2,3 dollar arasında olmuşdur — bu, cari mərhələdəki ölçmə hədəfidir, xidmət səviyyəsi zəmanəti deyil. Xərclər hər API zəngindən addıma, ssenaridən buraxılışa qədər toplanır və veb interfeysindən izlənilir.

Hansı AI modelləri dəstəklənir və model dəyişdirmək üçün yenidən yerləşdirmə lazımdırmı?

Argus QA model agnostikdir: koordinat əsaslandırma sahəsi, mühakimə səyi və provayder yönləndirməsi konfiqurasiya ilə idarə olunur, kod dəyişikliyi tələb etmir. Model kataloqları hər provayderın öz endpoint-indən canlı oxunur; vizual dəstək və koordinat əsaslandırma imkanları avtomatik yoxlanılır — bəzi routerlarda mövcud modellərin yalnız bir hissəsi şəkil qəbul edir. Model seçimi verilənlər bazasında saxlanılır və növbəti iş vahidindən etibarən dərhal qüvvəyə minir, yenidən yerləşdirməyə ehtiyac yoxdur.

Argus QA ilə Tanış Olun

Komandanızın test prosesini necə dəyişdirə biləcəyini görmək üçün bizimlə əlaqə saxlayın. Argus QA-nı öz mühitinizdə sınaqdan keçirin.

Demo tələb edin