İstifadə halları

Özəl Azərbaycan dilli LLM quraşdırın

Azərbaycan dili üçün nativ qurulmuş, tamamilə öz infrastrukturunuzda işləyən ilk böyük dil modeli. 587B, 99B və 39B ölçülərində.

Azərbaycan dili üçün nativ qurulmuş ilk böyük dil modeli

Allmaz-ın Azərbaycan dilli LLM-i, Azərbaycan dili üçün sıfırdan nativ olaraq qurulmuş dünyada ilk böyük dil modelidir. Model, 651 milyondan çox seçilmiş Azərbaycan sözündən ibarət kurasiya edilmiş korpus üzərində öyrədilmiş, xüsusi tokenizatoru isə ə hərfini və dilin aqlütinativ morfologiyasını — söz kökü, şəkilçi birləşmələri və çevik söz quruluşunu — dəqiq şəkildə işləmək üçün hazırlanmışdır. Bu yanaşma, ümumi məqsədli modellərdə müşahidə edilən dil boşluqlarını aradan qaldırır və Azərbaycan mətnini nativ səviyyədə başa düşən bir infrastruktur təmin edir. Model tamamilə sizin öz serverlərinizə yerləşdirilir: heç bir sorğu, heç bir sənəd, heç bir istifadəçi məlumatı xarici infrastruktura göndərilmir. 587B, 99B və 39B parametr ölçüləri ilə müxtəlif texniki imkanlara uyğunlaşan bu model, ümumi məqsədli alternativlərə nisbətən Azərbaycan mətni üzərində 4,6 dəfə daha səmərəli işləyir. Keyfiyyəti isə 11 fənni əhatə edən 38 139 nativ sualdan ibarət TUMLU benchmark-ı ilə ölçülə bilən şəkildə doğrulanmışdır.

İmkanlar

Bu modeli seçmək üçün 6 əsas səbəb

Azərbaycan dili üçün nativ qurulmuş ilk LLM — dil xüsusiyyətləri, o cümlədən aqlütinativ morfologiya və ə hərfi, modelin özülündən etibarən nəzərə alınıb

Tam on-premise yerləşdirmə: heç bir sorğu və ya məlumat xarici serverə göndərilmir, tam məlumat suverenliyi sizin əlinizdədir

Azərbaycan mətni üzərində 4,6 dəfə daha yüksək səmərəlilik — eyni keyfiyyəti daha az hesablama resursu ilə əldə edirsiniz

587B, 99B və 39B parametr variantları: mövcud server imkanlarınıza və iş yüküne görə optimal ölçünü seçmək mümkündür

651 milyondan çox seçilmiş Azərbaycan sözü üzərində öyrədilmiş zəngin dil korpusu — geniş kontekst dərinliyi və leksik əhatə

38 139 nativ sualdan ibarət, 11 fənni əhatə edən TUMLU benchmark-ı ilə ölçülə bilən, şəffaf keyfiyyət doğrulaması

Əsas xüsusiyyətlər

Nativ Azərbaycan tokenizatoru

Xüsusi tokenizator ə hərfini və Azərbaycan dilinin aqlütinativ morfologiyasını düzgün işləyir. Bu, söz kökü və şəkilçi strukturunu qoruyan dəqiq təhlil deməkdir.

Tam yerli yerləşdirmə (on-premise)

Model sizin öz serverlərinizdə işləyir. Heç bir sorğu, heç bir məlumat xarici infrastruktura göndərilmir — tam məlumat suverenliyi təmin olunur.

Çevik ölçü seçimi

587B, 99B və 39B parametr variantları mövcuddur. Resurs imkanlarınıza və performans tələblərinizə uyğun ölçünü seçə bilərsiniz.

Geniş öyrənmə korpusu

Model 651 milyondan çox seçilmiş Azərbaycan sözü üzərində öyrədilib. Bu, dil zənginliyini və kontekst dərinliyini təmin edir.

TUMLU benchmark doğrulaması

Modelin keyfiyyəti 38 139 nativ sualdan ibarət, 11 fənni əhatə edən TUMLU benchmark-ı ilə yoxlanılıb — ölçülə bilən, şəffaf qiymətləndirmə.

Azərbaycan mətni üzərində yüksək səmərəlilik

Ümumi məqsədli modellərə nisbətən Azərbaycan mətni üzərində 4,6 dəfə daha səmərəli işləyir — daha az hesablama resursu ilə daha yüksək keyfiyyət.

Necə işləyir?

1Tələblərinizi müəyyənləşdirin: istifadə ssenarisini, mövcud infrastrukturu və performans gözləntilərinizi bizimlə paylaşın.
2Uyğun model ölçüsünü seçin: 587B, 99B və ya 39B — resurs imkanlarınıza və iş yüküne görə optimal variant müəyyən edilir.
3Modeli öz infrastrukturunuzda yerləşdirin: quraşdırma prosesi sizin serverləriniz üzərində həyata keçirilir, məlumatlar şəbəkənizi tərk etmir.
4İnteqrasiya edin: mövcud sistemlər, tətbiqlər və iş axınları ilə birləşdirin.
5İstifadəyə başlayın: Azərbaycan dilini nativ başa düşən model real iş tapşırıqlarını yerinə yetirməyə hazırdır.

Tez-tez verilən suallar

Model niyə xüsusi olaraq Azərbaycan dili üçün sıfırdan qurulub, mövcud modellərin üzərində incə tənzimləmə (fine-tuning) kifayət deyilmi?

Azərbaycan dili aqlütinativ morfologiyası, ə kimi xüsusi hərfləri və zəngin şəkilçi sistemi ilə ümumi məqsədli modellər tərəfindən zəif təmsil olunur. Bu modellərin tokenizatorları Azərbaycan sözlərini düzgün parçalamır, bu da məntiqi xətalara və keyfiyyət itkisinə səbəb olur. Allmaz-ın modeli isə nativ tokenizatoru və 651 milyondan çox seçilmiş Azərbaycan sözündən ibarət korpusu ilə dili əvvəldən düzgün başa düşmək üçün qurulmuşdur.

Məlumatlarımın təhlükəsizliyi necə təmin olunur?

Model tamamilə sizin öz infrastrukturunuzda (on-premise) işləyir. Heç bir istifadəçi sorğusu, sənəd və ya cavab xarici serverə göndərilmir. Bütün emal sizin şəbəkənizin daxilində baş verir — tam nəzarət və məlumat suverenliyi sizdədir.

Hansı parametr ölçüsünü seçməliyəm: 587B, 99B, yoxsa 39B?

Seçim mövcud server resurslarınıza, gecikməyə (latency) olan tələblərinizə və istifadə ssenarinizdən asılıdır. 587B ən yüksək dəqiqlik və dərinliyi, 39B isə daha məhdud aparat resursları ilə sürətli işləməyi təmin edir. 99B isə bu iki tələb arasında balans axtaranlar üçün uyğundur. Komandamız tələblərinizi qiymətləndirərək optimal variant üçün məsləhət verə bilər.

TUMLU benchmark nədir və niyə əhəmiyyətlidir?

TUMLU, 11 müxtəlif fənni — o cümlədən dil, riyaziyyat, elm və humanitar sahələri — əhatə edən 38 139 nativ Azərbaycan sualından ibarət qiymətləndirmə çərçivəsidir. Bu benchmark, modelin Azərbaycan dilindəki real anlama qabiliyyətini ölçülə bilən və şəffaf şəkildə sınaqdan keçirir. Allmaz-ın modeli məhz bu benchmark üzərində doğrulanmışdır.

Modeli mövcud sistemlərimizlə inteqrasiya etmək mümkündürmü?

Bəli. Model standart inteqrasiya imkanları vasitəsilə mövcud tətbiqlərinizə, iş axınlarınıza və korporativ platformalarınıza birləşdirilə bilər. Allmaz komandası inteqrasiya prosesinin hər mərhələsində texniki dəstək göstərir.

Azərbaycan dilli LLM-i öz infrastrukturunuzda qurun

Azərbaycan dilini nativ başa düşən, məlumatlarınızı şəbəkənizdə saxlayan bu modeli necə tətbiq edə biləcəyinizi öyrənmək üçün Allmaz komandası ilə əlaqə saxlayın.

Demo tələb edin