Omnilingual SONAR: Cross-Lingual and Cross-Modal Sentence Embeddings Bridging Massively Multilingual Text and Speech
Omnilingual SONAR Team, João Maria Janeiro, Pere-Lluís Huguet Cabot, Ioannis Tsiamas, Yen Meng,
Vivek Iyer, Guillem Ramírez, Loic Barrault, Belen Alastruey, Xiang "Tony" Cao, Yu-An Chung, Marta R. Costa-Jussa, David Dale, Kevin Heffernan, Jaehyeong Jo, Artyom Kozhevnikov, Alexandre Mourachko, Christophe Ropers, Holger Schwenk, and Paul-Ambroise Duquenne
2026
Omnilingual SONAR is a massively multilingual speech-text sentence embedding model spanning 1500+ languages. I led post-training efforts for Spectrum, an omnilingual, cross-modal encoder-decoder language model that reasons over OmniSONAR’s language and modality-agnostic space to provide seamless zero-shot cross-lingual and cross-modal performance — while also significantly enhancing long-context efficiency.