Preprint2024
Jina Bilingual Embeddings
Unknown
A suite of bilingual text embedding models supporting up to 8192 tokens, trained via modified BERT pre-training and multi-task contrastive learning.
0Feb 1, 2024
arXiv
A comprehensive index of artificial intelligence and machine-learning research with AI-generated summaries, citation metrics, and direct links to papers and code.
Unknown
A suite of bilingual text embedding models supporting up to 8192 tokens, trained via modified BERT pre-training and multi-task contrastive learning.
Unknown
A bilingual Hindi-English language model built by continuously pre-training Nemotron-Mini 4B on 400B real and synthetic tokens.