VultronRetriever: High-Performance Offline Retrieval Models Released
The VultronRetriever family of models has been released on HuggingFace, offering state-of-the-art retrieval performance for edge devices. These models range from 0.8B to 8B parameters and are optimized for offline Q&A and document embedding.
Reddit r/MachineLearning · 69d ago












