Özəl Azərbaycan dilli LLM quraşdırın
Azərbaycan dili üçün nativ qurulmuş, tamamilə öz infrastrukturunuzda işləyən ilk böyük dil modeli. 587B, 99B və 39B ölçülərində.
Azərbaycan dili üçün nativ qurulmuş ilk böyük dil modeli
Allmaz-ın Azərbaycan dilli LLM-i, Azərbaycan dili üçün sıfırdan nativ olaraq qurulmuş dünyada ilk böyük dil modelidir. Model, 651 milyondan çox seçilmiş Azərbaycan sözündən ibarət kurasiya edilmiş korpus üzərində öyrədilmiş, xüsusi tokenizatoru isə ə hərfini və dilin aqlütinativ morfologiyasını — söz kökü, şəkilçi birləşmələri və çevik söz quruluşunu — dəqiq şəkildə işləmək üçün hazırlanmışdır. Bu yanaşma, ümumi məqsədli modellərdə müşahidə edilən dil boşluqlarını aradan qaldırır və Azərbaycan mətnini nativ səviyyədə başa düşən bir infrastruktur təmin edir. Model tamamilə sizin öz serverlərinizə yerləşdirilir: heç bir sorğu, heç bir sənəd, heç bir istifadəçi məlumatı xarici infrastruktura göndərilmir. 587B, 99B və 39B parametr ölçüləri ilə müxtəlif texniki imkanlara uyğunlaşan bu model, ümumi məqsədli alternativlərə nisbətən Azərbaycan mətni üzərində 4,6 dəfə daha səmərəli işləyir. Keyfiyyəti isə 11 fənni əhatə edən 38 139 nativ sualdan ibarət TUMLU benchmark-ı ilə ölçülə bilən şəkildə doğrulanmışdır.
Bu modeli seçmək üçün 6 əsas səbəb
Azərbaycan dili üçün nativ qurulmuş ilk LLM — dil xüsusiyyətləri, o cümlədən aqlütinativ morfologiya və ə hərfi, modelin özülündən etibarən nəzərə alınıb
Tam on-premise yerləşdirmə: heç bir sorğu və ya məlumat xarici serverə göndərilmir, tam məlumat suverenliyi sizin əlinizdədir
Azərbaycan mətni üzərində 4,6 dəfə daha yüksək səmərəlilik — eyni keyfiyyəti daha az hesablama resursu ilə əldə edirsiniz
587B, 99B və 39B parametr variantları: mövcud server imkanlarınıza və iş yüküne görə optimal ölçünü seçmək mümkündür
651 milyondan çox seçilmiş Azərbaycan sözü üzərində öyrədilmiş zəngin dil korpusu — geniş kontekst dərinliyi və leksik əhatə
38 139 nativ sualdan ibarət, 11 fənni əhatə edən TUMLU benchmark-ı ilə ölçülə bilən, şəffaf keyfiyyət doğrulaması
Əsas xüsusiyyətlər
Nativ Azərbaycan tokenizatoru
Xüsusi tokenizator ə hərfini və Azərbaycan dilinin aqlütinativ morfologiyasını düzgün işləyir. Bu, söz kökü və şəkilçi strukturunu qoruyan dəqiq təhlil deməkdir.
Tam yerli yerləşdirmə (on-premise)
Model sizin öz serverlərinizdə işləyir. Heç bir sorğu, heç bir məlumat xarici infrastruktura göndərilmir — tam məlumat suverenliyi təmin olunur.
Çevik ölçü seçimi
587B, 99B və 39B parametr variantları mövcuddur. Resurs imkanlarınıza və performans tələblərinizə uyğun ölçünü seçə bilərsiniz.
Geniş öyrənmə korpusu
Model 651 milyondan çox seçilmiş Azərbaycan sözü üzərində öyrədilib. Bu, dil zənginliyini və kontekst dərinliyini təmin edir.
TUMLU benchmark doğrulaması
Modelin keyfiyyəti 38 139 nativ sualdan ibarət, 11 fənni əhatə edən TUMLU benchmark-ı ilə yoxlanılıb — ölçülə bilən, şəffaf qiymətləndirmə.
Azərbaycan mətni üzərində yüksək səmərəlilik
Ümumi məqsədli modellərə nisbətən Azərbaycan mətni üzərində 4,6 dəfə daha səmərəli işləyir — daha az hesablama resursu ilə daha yüksək keyfiyyət.
Necə işləyir?
Tez-tez verilən suallar
Model niyə xüsusi olaraq Azərbaycan dili üçün sıfırdan qurulub, mövcud modellərin üzərində incə tənzimləmə (fine-tuning) kifayət deyilmi?
Azərbaycan dili aqlütinativ morfologiyası, ə kimi xüsusi hərfləri və zəngin şəkilçi sistemi ilə ümumi məqsədli modellər tərəfindən zəif təmsil olunur. Bu modellərin tokenizatorları Azərbaycan sözlərini düzgün parçalamır, bu da məntiqi xətalara və keyfiyyət itkisinə səbəb olur. Allmaz-ın modeli isə nativ tokenizatoru və 651 milyondan çox seçilmiş Azərbaycan sözündən ibarət korpusu ilə dili əvvəldən düzgün başa düşmək üçün qurulmuşdur.
Məlumatlarımın təhlükəsizliyi necə təmin olunur?
Model tamamilə sizin öz infrastrukturunuzda (on-premise) işləyir. Heç bir istifadəçi sorğusu, sənəd və ya cavab xarici serverə göndərilmir. Bütün emal sizin şəbəkənizin daxilində baş verir — tam nəzarət və məlumat suverenliyi sizdədir.
Hansı parametr ölçüsünü seçməliyəm: 587B, 99B, yoxsa 39B?
Seçim mövcud server resurslarınıza, gecikməyə (latency) olan tələblərinizə və istifadə ssenarinizdən asılıdır. 587B ən yüksək dəqiqlik və dərinliyi, 39B isə daha məhdud aparat resursları ilə sürətli işləməyi təmin edir. 99B isə bu iki tələb arasında balans axtaranlar üçün uyğundur. Komandamız tələblərinizi qiymətləndirərək optimal variant üçün məsləhət verə bilər.
TUMLU benchmark nədir və niyə əhəmiyyətlidir?
TUMLU, 11 müxtəlif fənni — o cümlədən dil, riyaziyyat, elm və humanitar sahələri — əhatə edən 38 139 nativ Azərbaycan sualından ibarət qiymətləndirmə çərçivəsidir. Bu benchmark, modelin Azərbaycan dilindəki real anlama qabiliyyətini ölçülə bilən və şəffaf şəkildə sınaqdan keçirir. Allmaz-ın modeli məhz bu benchmark üzərində doğrulanmışdır.
Modeli mövcud sistemlərimizlə inteqrasiya etmək mümkündürmü?
Bəli. Model standart inteqrasiya imkanları vasitəsilə mövcud tətbiqlərinizə, iş axınlarınıza və korporativ platformalarınıza birləşdirilə bilər. Allmaz komandası inteqrasiya prosesinin hər mərhələsində texniki dəstək göstərir.
Azərbaycan dilli LLM-i öz infrastrukturunuzda qurun
Azərbaycan dilini nativ başa düşən, məlumatlarınızı şəbəkənizdə saxlayan bu modeli necə tətbiq edə biləcəyinizi öyrənmək üçün Allmaz komandası ilə əlaqə saxlayın.
Demo tələb edin