
Hugging Face Introduces Multimodal Embedding & Reranker Models
Hugging Face has released new multimodal embedding and reranker models via Sentence Transformers. These models enable advanced cross-modal retrieval and ranking capabilities.
27 stories tagged Multimodal · page 2 of 2

Hugging Face has released new multimodal embedding and reranker models via Sentence Transformers. These models enable advanced cross-modal retrieval and ranking capabilities.
Gemma 4 is a new multimodal intelligence model. It runs on devices, enabling local AI processing.
OpenAI's new Realtime Video API lets developers pipe live camera streams directly to GPT-5V, enabling sub-second visual understanding for robotics, accessibility tools, and consumer apps.