Darmm/darmm-embedding-multilingual
Sentence Similarity • 0.6B • Updated • 86
Embedding Models that was mainly trained with Kazakh language
Note v2 — general-purpose Kazakh retrieval, bge-m3 fine-tune; beats base and v1 on all benchmarks
Note 373k training pairs + held-out retrieval/cross-lingual eval sets