Xarici bulud LLM-ə alternativ
Azərbaycan dili üçün nativ qurulmuş, tamamilə öz infrastrukturunuzda işləyən ilk böyük dil modeli. 587B, 99B və 39B ölçülərində.
Xarici bulud LLM-lərinə yerli alternativ
Mövcud bulud əsaslı böyük dil modellərinin böyük əksəriyyəti əsasən ingilis dili üçün optimallaşdırılmış tokenizerlər üzərində qurulub. Bu modellər Azərbaycan dilinin ə hərfini, sözönü və şəkilçi sistemini, habelə aqlütinativ morfologiyasını düzgün emal edə bilmir — nəticədə token itkisi artır, dil keyfiyyəti aşağı düşür və müəssisə məlumatları xarici serverlərdə emal edilir. Allmaz bu problemi kökündən həll etmək üçün sıfırdan Azərbaycan dili üçün nativ olaraq qurulmuş ilk böyük dil modelidir. 651 milyondan çox kurasiyalı Azərbaycan sözü üzərində öyrədilmiş model, nativ tokenizeri sayəsində ümumi bulud modelləri ilə müqayisədə Azərbaycan mətni üzərində 4,6 dəfə daha səmərəli işləyir.
Niyə Allmaz?
Tam on-premise yerləşdirmə — məlumatlarınız heç vaxt şəbəkənizi tərk etmir, xarici infrastruktura heç bir məlumat ötürülmür
Azərbaycan dili üçün nativ qurulmuş ilk LLM — dil sonradan əlavə edilməyib, model sıfırdan bu dil üçün hazırlanıb
651 milyondan çox kurasiyalı Azərbaycan sözü üzərində öyrədilmiş dərin dil anlayışı
ə hərfini və aqlütinativ morfologiyanı dəqiq emal edən nativ tokenizer — token itkisi aradan qaldırılıb
Azərbaycan mətni üzərində ümumi bulud modelləri ilə müqayisədə 4,6 dəfə daha yüksək emal səmərəliliyi
38.139 yerli sualı əhatə edən TUMLU benchmark-ı ilə 11 fənn üzrə müstəqil şəkildə doğrulanmış dil keyfiyyəti
587B, 99B və 39B parametr ölçüləri — müəssisənizin resurslarına və tələblərinə uyğun çevik seçim imkanı
Əsas xüsusiyyətlər
Tam on-premise yerləşdirmə
Model tamamilə sizin infrastrukturunuzda işləyir. Heç bir məlumat xarici bulud serverinə göndərilmir, beləliklə məlumat məxfiliyi və tənzimləyici uyğunluq tam təmin edilir.
Nativ Azərbaycan dili dəstəyi
Model sıfırdan Azərbaycan dili üçün qurulub. Nativ tokenizer ə hərfini və dilin aqlütinativ quruluşunu düzgün tanıyır, ümumi bulud modellərindəki token itkisi aradan qaldırılır.
Çevik parametr ölçüləri
587B, 99B və 39B parametr variantları mövcuddur. Müəssisənizin hesablama resurslarına və tələblərinə uyğun ölçünü seçə bilərsiniz.
Geniş öyrətmə korpusu
Model 651 milyondan çox kurasiyalı Azərbaycan sözü üzərində öyrədilib, bu da dil anlayışının dərinliyini və dəqiqliyini artırır.
TUMLU benchmark doğrulaması
Model 38.139 yerli sualı əhatə edən TUMLU benchmark-ı vasitəsilə 11 fənn üzrə müstəqil şəkildə qiymətləndirilib və doğrulanıb.
Yüksək emal səmərəliliyi
Azərbaycan mətni üzərində ümumi bulud modelləri ilə müqayisədə 4,6 dəfə daha səmərəli işləyir, bu da əməliyyat xərclərini azaldır.
Necə işləyir?
Tez-tez verilən suallar
Məlumatlarım xarici serverə göndərilirmi?
Xeyr. Allmaz tamamilə on-premise yerləşdirilir — bütün emal sizin şəbəkəniz daxilində baş verir. Heç bir sorğu, cavab və ya istifadəçi məlumatı xarici infrastrukturaya ötürülmür. Bu, həm məlumat məxfiliyini, həm də tənzimləyici uyğunluq tələblərini tam qarşılayır.
Ümumi bulud LLM-ləri Azərbaycan dilini niyə tam dəstəkləmir?
Əksər bulud modelləri əsasən ingilis dili üçün optimallaşdırılmış tokenizerlər istifadə edir. Bu tokenizerlar ə hərfini və Azərbaycan dilinin aqlütinativ morfologiyasını — yəni sözönü, şəkilçi və söz kökü sistemini — düzgün emal edə bilmir. Nəticədə token itkisi artır, model dili düzgün başa düşmür və çıxış keyfiyyəti aşağı düşür. Allmaz-ın nativ tokenizeri bu problemi kökündən aradan qaldırır.
TUMLU benchmark nədir və nə üçün vacibdir?
TUMLU, 38.139 yerli Azərbaycan sualını əhatə edən, 11 müxtəlif fənn üzrə hazırlanmış müstəqil qiymətləndirmə benchmark-ıdır. Bu benchmark Azərbaycan dilindəki dil modelinin real dünya suallarına nə dərəcədə düzgün cavab verdiyini ölçür. Allmaz bu benchmark vasitəsilə doğrulanmışdır, bu da modelin dil keyfiyyətini şəffaf və ölçülə bilən şəkildə nümayiş etdirir.
Hansı parametr ölçüsünü seçməliyəm?
Allmaz 587B, 99B və 39B parametr ölçülərində mövcuddur. 587B ən yüksək dil keyfiyyəti və mürəkkəb tapşırıqlar üçün uyğundur; 99B orta mürəkkəblikdəki istifadə ssenarilərini daha az hesablama resursu ilə idarə edir; 39B isə sürət və resurs səmərəliliyini ön plana çəkən mühitlər üçün nəzərdə tutulub. Seçim müəssisənizin mövcud infrastrukturuna, gecikməyə dair tələblərinə və istifadə ssenarisinin mürəkkəbliyinə əsaslanmalıdır.
Model hansı həcmdə Azərbaycan dili məlumatı üzərində öyrədilib və bu niyə əhəmiyyətlidir?
Allmaz 651 milyondan çox kurasiyalı Azərbaycan sözü üzərində öyrədilib. Məlumatların kurasiya edilmiş olması modelin yalnız həcmli deyil, eyni zamanda keyfiyyətli dil nümunələri üzərində öyrəndiyini bildirir. Bu da modelin Azərbaycan dilinin incəliklərini, lüğət zənginliyini və qrammatik quruluşunu daha dəqiq mənimsəməsini təmin edir.
Allmaz mövcud müəssisə infrastrukturuna inteqrasiya oluna bilirmi?
Bəli. Allmaz sizin serverlərinizə və ya özəl bulud mühitinizə yerləşdirilir və tətbiqləriniz API vasitəsilə modellə əlaqə qurur. Bütün emal şəbəkəniz daxilində qaldığından mövcud təhlükəsizlik siyasətləriniz və infrastruktur arxitekturanız dəyişdirilmədən qorunur.
Azərbaycan dili üçün nativ LLM-i sınayın
Məlumatlarınız şəbəkənizdə qalsın, Azərbaycan dilinin gücündən tam yararlanan bir model ilə tanış olun. Allmaz komandası ilə əlaqə saxlayın.
Demo tələb edin