Impressive models! 🚀 Congrats!!!
We now have new SOTA encoder backbone.
Our mGTE-MLM-base outperforms XLM-R-base in 2024 summer (or jan by training), its a "semi-modern" encoder 😃.
Glad to see it stands as one of only two baselines, alongside XLM-R.
XLM-R has been SOTA for 6 years for multilingual encoders. That's an eternity in AI 🤯
Time for an upgrade. Introducing mmBERT: 2-4x faster than previous models ⚡ while even beating o3 and Gemini 2.5 Pro 🔥
+ open models & training data - try it now!
How did we do it? 🧵

