NLP resources

660K-AZ-EN-Parallel — Azerbaijani NLP dataset

660K-AZ-EN-Parallel is a 666K pairs Azerbaijani translation dataset — Largest public Az-En parallel corpus; includes reliability scores and source tracking. License: unknown. Catalogued in the Allmaz Azerbaijani NLP resource roster.

About

Largest public Az-En parallel corpus; includes reliability scores and source tracking

Type
dataset
Size
666K pairs
Domain
translation
License
unknown
Source
HuggingFace / omar07ibrahim
Layer
2