Skip to content
Advertisement
Text

IN22GenBitextMining

IN22GenBitextMining An MTEB dataset Massive Text Embedding Benchmark IN22-Gen is a n-way parallel general-purpose multi-domain benchmark dataset for…

IN22GenBitextMining An MTEB dataset Massive Text Embedding Benchmark IN22-Gen is a n-way parallel general-purpose multi-domain benchmark dataset for machine translation spanning English and 22 Indic languages. Task category t2t Domains Web, Legal, Government, News, Religious, Non-fiction, Written Reference Source datasets: mteb/IN22-Gen How to evaluate on this task You can evaluate an embedding model… See the full description on the dataset page:

Source: Hugging Face Hub (mteb/IN22GenBitextMining). Metadata imported from the dataset’s Hub tags.

Advertisement